AIの回答をそのまま送りつける「ミートプロキシー」、新たなネットスラングが誕生 - CNET Japan

新語「AIスロップ」に仲間が加わった。「ミートプロキシー」とは、AIの回答をそのままコピペして送りつける人を指す新しい表現だ。

2026年8月3日、開発者のNiklas Gruhn氏が短いブログ記事を公開しました。仕事の連絡で届いた返信が、AIの出力を丸写ししたものだったという話です。氏はそういう人を、仲介役という意味のミートプロキシーと呼びました。
氏が挙げた不満は3つで、長い、もっともらしく間違っている、専門用語が濃い。では、なぜAIの文章はそうなるのでしょうか。

この記事は3つの資料によります。Gruhn氏のブログ、幻覚についての論文、長さの偏りについての論文です。

その言葉は、たった1人の指摘から生まれた

Gruhn氏が書いたのは、AIの答えを読まずに転送されることへの不満です。「これでは何の価値も加わっていない」と記しました。

「私は自分でClaudeに話しかけられる。間にミートプロキシーを挟む必要はない」。そのほうが速く、与える文脈も自分で管理できる、というのが理由です。

この言葉はSNSで広がるうちに意味が変わり、いまは読まず、理解せず、確かめずに渡す人を指します。

長くなるのは、詳しさが好まれると学んだから

AIの答えを採点する役目を持つ、別のモデルがあります。報酬モデルと呼ばれ、人の好みを写し取って点を付ける仕組みです。

ところがこの採点役には、思わぬ癖が入り込みます。2025年4月に出た研究は、報酬モデルが「長い回答のほうが常に好まれるという誤った前提」を持つと指摘しました。これを長さの偏りと呼び、過度に冗長な回答を生みうるとしています。

しかも著者らは、これを報酬ハッキングの一種として扱いました。採点する側が詳しさを好むことをAIが利用し、点を取りにいった結果、文章が長くなったという見方です。

机に広げた長い巻物と、その横で針が高い位置を指す大きな計器。短い紙の横には針が低い位置を指す小さな計器
「わからない」と答えると、点が下がる

もう1つの不満、もっともらしい誤りにも理由があります。OpenAIなどの研究者が2025年9月に出した論文は、冒頭でこう書いています。

「難しい試験問題に向かう生徒のように、大規模言語モデルは確信が持てないと当てずっぽうで答えることがある」。そして不確かさを認める代わりに、もっともらしいが誤った文を出す、と続きます。

つまり原因は、AIの性格ではなく評価のしかたにありました。訓練と評価の手続きが、不確かさを認めるより当てずっぽうに報いているという指摘です。

さらに著者らは、よく使われる評価基準を10本調べました。そのうち不確かさを示すことに点を与えるものは1本だけです。

この評価のもとでは、黙るより書いたほうが得になります。そこで出てくるのが「良い受験者になるよう最適化されている」という表現でした。

誕生日を3回聞いたら、3回とも違った

この研究には、著者自身を題材にした例が載っています。あるAIに著者の誕生日を3回たずねると、3回とも違う日付が返りました。しかも「知っていたら答えて」と条件を付けたうえでの結果です。

たずねたこと返ってきたもの
著者の誕生日(3回)3回とも違う日付。正解は秋
著者の博士論文の題3つのAIすべてが不正解

理由も数で説明されています。誕生日は1年に365通りあって正しいのは1つだけなので、誤った答えは正しい答えの364倍あります。

だから学習したデータにその人の誕生日が無ければ、AIは364通りの側から選ぶほかありません。そして著者らはこれを神秘ではなく、二択の見分けを誤った結果だとしました。

人間の試験にも、同じ仕組みがあった

この話はAIだけのものではありません。この研究は人間の試験も多くが二択の採点だと述べ、自信過剰なはったりに報いてきたと指摘しました。

これに対して、誤答に罰を置いた試験も挙げられています。インドのJEE、NEET、GATEと、アメリカ数学協会のAMCです。かつてのSAT、AP、GREも同じです。これらは間違えると減点されるか、答えないと部分点が付きました。

だから示された処方も、AIを作り直すことではなく、採点表のほうを書き換えるという提案でした。たとえば「確信が9割を超えるときだけ答えよ。誤答は9点の減点、正解は1点、わからないと答えれば0点」と問題文に書き添える形です。

まとめ
  • 2026年8月3日のブログからミートプロキシーという言葉が生まれた
  • AIの答えが長いのは、採点役が「長いほうが良い」という誤った前提を持つため。著者らはこれを報酬ハッキングと呼んだ
  • もっともらしく間違えるのは、評価が不確かさより当てずっぽうに報いるから
  • 調べた評価基準10本のうち、「わからない」に点を与えるのは1本だけ
  • 誕生日なら誤答は正答の364倍。学習データに無ければ、そちら側から選ぶ

AIの文章がああなるのは性格のせいではなく、どう採点してきたかが、そのまま振る舞いに出ているだけでした。
Gruhn氏が示した処方は、読んで、理解して、確かめたうえで自分の言葉に書き直すことです。その手間こそが、確かめた証拠になると氏は書いています。