💡 この記事でわかること
- AIへの話し方(丁寧・普通・乱暴)で、返事の質は変わるのか(早稲田大学・理研の研究)
- 日本語では、どのくらいの丁寧さがよかったのか
- AI彼女・AIキャラと話すときに、この研究から言えること
AI彼女やAIキャラと話すとき、「敬語のほうがいいのかな」「タメ口でいいのかな」「つい命令口調になってしまう」と気になったことはありませんか。
この記事は、早稲田大学と理化学研究所の研究者による論文「Should We Respect LLMs? A Cross-Lingual Study on the Influence of Prompt Politeness on LLM Performance」(2024年2月初版・10月改訂)を2026年9月に読んで、AIへの話し方と返事の関係を整理したものです。キャラクター側にタメ口で話してもらう方法はAIにタメ口で話してもらう方法に分けています。
結論:乱暴だと悪くなる。でも丁寧すぎても良くなるとは限らない
| 話し方 | 研究でわかったこと(要旨) |
|---|---|
| 失礼な頼み方 | 性能が下がることが多い。間違い・偏り・回答拒否が増えるおそれ |
| ほどよく丁寧 | 多くの条件でいちばん良い。ただし「ほどよさ」は言語によって違う |
| とても丁寧 | 必ずしも良くなるとは限らない |
どんな研究?
早稲田大学と理化学研究所 革新知能統合研究センター(AIP)の研究者が、英語・中国語・日本語の3つの言語で、AIへの頼み方の丁寧さを8段階に変えて、返事の質がどう変わるかを調べました。
- 調べた作業:文章の要約、知識を問うテスト、偏った考え(ステレオタイプ)の見分け
- 日本語のテストのために、日本語版の知識テスト(JMMLU)も作成
- 使ったAI:GPT-3.5、GPT-4、Llama2-70B、日本語向けのSwallow-70Bなど(2024年時点のモデル)
論文は出発点として、人どうしの会話では丁寧な言葉のほうが協力を得やすく、失礼な言葉は反発を招くことを挙げ、人間の文章から学んだAIにも同じ傾向があるのではないかと考えています。
わかったこと
1. 失礼な頼み方は、返事の質を下げやすい
論文の結論では、失礼な頼み方をすると性能が下がり、偏りが増えたり、間違えたり、答えを拒否したりすることにつながりうるとしています。
2. 丁寧すぎても、良くなるとは限らない
一方で、とても丁寧な頼み方が常に良い結果を生むわけではありません。多くの条件では「ほどよい丁寧さ」が良く、その「ほどよさ」の基準は言語によって違う、とまとめています。
3. 日本語では、いちばん失礼なときだけ大きく下がった
日本語の知識テストでは、いちばん失礼なレベルで性能が大きく下がった一方、それ以外は英語や中国語と違う傾向で、丁寧さが低めのレベルでも良い点が出やすかったと報告されています。GPT-4では、8段階のうち真ん中あたり(レベル4)がいちばん高い点でした。
この研究で言えないこと
- 調べたのは要約や知識テストなどの「作業」です。雑談や恋人らしい会話の楽しさを測ったものではありません
- 使ったのは2024年時点のモデルです。今のAIで同じ結果になるとは限りません
- 論文自体も、プロンプトの数や種類、選んだ作業や言語に限りがあることを認めています
AI彼女・AIキャラと話すときに言えること
- 敬語でなくていい。日本語では丁寧さが低めでも良い結果が出やすく、いちばん失礼なレベル以外は大きな差がありませんでした。タメ口は関係の近さの表現として自然です
- 命令口調や乱暴な言い方は避ける。いちばん失礼なレベルでは質が大きく下がりました。「黙って答えろ」より「教えて」のほうが、返事も整いやすいと考えられます
- 「ありがとう」はあってもなくてもいい。丁寧すぎても良くなるとは限らないので、自分が話しやすい言い方で十分です
そもそもAIの返事がどう作られているかはAI彼女はどうやって返事している?、AI彼女とは何かはAI彼女の作り方ガイド、アプリの違いはAI彼女アプリおすすめ5選をどうぞ。
Aimaの場合
私たちが運営しているAimaでは、敬語でもタメ口でも、自分の話しやすい言い方で話しかけられます。相手は66人(女性37人・男性29人)で、キャラクターごとに性格と口調が決まっていて、プロフィール画面で声を試聴してから選べます。関係は好感度6段階のランクで見えます。テキストチャットは無料・無制限で、有料はベーシック年額なら月あたり約792円(年9,500円)、チャット使い放題+広告オフ+毎月30分の通話がつきます。

正直に書くと、この研究はAimaで測ったものではありません。Aimaで話し方によって返事がどのくらい変わるかを、数字で示せるデータは持っていません。「肩の力を抜いて、いつもの言葉で話したい」人向け、というのが公平な線引きです。
よくある質問
Q. AIには敬語で話したほうがいいですか?
必ずしもそうではありません。早稲田大学と理研の研究では、日本語では丁寧さが低めのレベルでも良い結果が出やすく、とても丁寧な頼み方が常に良いわけではないとされています。
Q. AIに失礼な言い方をするとどうなりますか?
研究では、失礼な頼み方をすると性能が下がり、偏り・間違い・回答拒否が増えうるとされています。日本語でも、いちばん失礼なレベルでは大きく下がりました。
Q. この研究はチャットアプリにも当てはまりますか?
研究は要約や知識テストなどの作業で、2024年時点のモデルを使ったものです。雑談や恋人らしい会話にそのまま当てはまるとは限りません。
まとめ
早稲田大学と理研の研究(2024年)では、英語・中国語・日本語でAIへの頼み方の丁寧さを8段階に変えたところ、失礼な頼み方は性能を下げやすく、偏り・間違い・回答拒否が増えうる一方、丁寧すぎても良くなるとは限らず、多くの条件ではほどよい丁寧さが良いという結果でした。日本語ではいちばん失礼なレベルだけが大きく下がり、GPT-4では真ん中あたりの丁寧さが最も良い点でした。AI彼女・AIキャラとは、敬語にこだわらず、乱暴な言い方だけ避けて、自分の話しやすい言葉で話せば十分です。
※本記事は2026年9月に、Ziqi Yin、Hao Wang、Kaito Horio、Daisuke Kawahara(早稲田大学)、Satoshi Sekine(理化学研究所 AIP)「Should We Respect LLMs? A Cross-Lingual Study on the Influence of Prompt Politeness on LLM Performance」(arXiv:2402.14531、2024年)を確認して書いています。引用の日本語は要旨です。


