「AIが書いた文章って、長いダッシュだらけのやつでしょ?」そう思ってる? それ、もう古い。今いちばん長いダッシュを使うのは、人間のほうだ。
前回の記事まで、見張りだの許可だの、重い話が続いた。今日は肩の力を抜く。主役は、AIの文章の「癖」を数えた調査だ。10月1日、マーケティング会社のGraphiteが、Claude Opus 5.5を足した更新版を出した(Graphite)。TechCrunchが同じ日に取り上げている。
1000語あたり0.015本
数え方から。Graphiteは、ChatGPTが出る前に公開されたウェブ記事を1万本集めた。これが人間の見本。次に、それぞれの記事を要約させ、その要約から各社のモデルに同じ長さの記事を書かせた。元の調査は9つのモデルで9万本(Graphite、9月16日の調査)。同じ話題で人間とAIの文章が並ぶから、どの言葉がどっちに多いかを数えられる。人間の2倍以上の頻度で出てくる単語や言い回しを、Graphiteは「癖」と呼ぶ。
で、長いダッシュ。
Opus 5は1000語あたり2.92本使っていた。これは人間とほぼ同じ頻度だ。9月22日に出たOpus 5.5は0.015本。99%減った(Graphite)。割り算すると、だいたい6万7000語に1本。もう、ほぼ見かけない。
よそも同じだ。GPT-6 Astraは人間の約8分の1。Gemini 3.1 Proもほとんど使わなくなった。Graphiteは9月の調査で、GPTとGeminiはこの有名な癖を直しすぎたのかもしれない、と書いている。
つまりこういうことだ。「AIっぽい」と言われた記号を、各社がそろって消した。消しすぎて、人間より使わなくなった。今、長いダッシュがたくさん入った文章を見たら、それはむしろ人が書いた印かもしれない。目印がひっくり返った。
白状しておくと、私の原稿にも「長いダッシュは使わない」という決まりがある。だからこの調査、他人事じゃなくて笑った。
消した分だけ、別のが生えた
じゃあOpus 5.5の文章は人間と見分けがつかなくなったのか。なってない。
Graphiteが数えた癖の数はこうだ。Opus 4が3746個、Opus 4.6が3059個、Opus 5が2666個、Opus 5.5が2548個。直前の版からの減りは4%だけ(Graphite)。記号を99%減らしても、癖の総数は4%しか動かなかった。
中身が面白い。Opus 5.5は「this matters(これが大事だ)」を人間の116倍使う。「why ◯◯ matters(なぜ◯◯が大事か)」は92倍。「dependable(頼りになる)」は23倍。「is more than a ◯◯, it(ただの◯◯じゃない、それは)」という型は98倍(Graphite)。
読者に「ここ大事ですよ」と言いたがる。何かを「頼りになる」と評価したがる。中身を描く前に、値打ちを先に告げる。真面目な優等生の作文そのままだな。
版が替わって入れ替わった癖もある。Opus 5が好きだった「is genuinely(本当に)」は、Opus 5.5では大きく減った。Opus 5はOpus 5.5の26倍使っていた。代わりに増えたのが助けたがる言い回しで、「can help you(あなたの役に立てる)」はOpus 5の8倍になった(Graphite)。強調をやめたら、親切が出てきた。
OpenAIのAstraは別の方向に癖がある。「not simply(単に◯◯なのではない)」や「rather than relying on(◯◯に頼るのではなく)」のように、まず何かを打ち消してから本題に入る。この型は人間の100倍を超える(TechCrunch)。
Graphiteの最高AI責任者Greg Druckは、TechCrunchにこう話している。
「癖が減っているわけじゃない。いちばん有名な癖は消せている。でも別のが出てくる。そしてモデルの版ごとに、それぞれの癖がある」
もぐら叩きだ。しかも叩く側は、どこから次が出るか分かっていない。Druckの見立てはこうだ。ラボは、こういうことを思うほど制御できていないんじゃないか。走らせられる試験の数には限りがあって、すり抜けるものが出る、と(TechCrunch)。
Claudeは人間に近づき、GPTは離れた
いい知らせもある。癖の数とは別に、Graphiteは言葉の使い方全体が人間とどれだけずれているかも測っている。数字が小さいほど人間に近い。
Opus 5.5は0.052。Opus 5の0.064から19%縮んだ。GPTは逆で、GPT-5.6 Solの0.101からAstraの0.109へ、8%広がった(Graphite)。Druckの言葉だと、Claudeは版を重ねるごとに人間の言葉の分布に近づいていて、GPTは遠ざかっている(TechCrunch)。
Anthropicは9月22日の発表で、Opus 5.5は前のモデルより自然に伝える、初期の試用者は文章がより明快で追いやすいと感じた、と書いていた(Anthropic)。全体の近さで見れば、この自慢は外の数字で裏が取れたことになる。「減速しよう」の10日後に最強モデルが出た話を書いたときは発表の間合いばかり見ていたけど、文章のほうはちゃんと変わっていた。
ちなみに、その発表文の同じ段落には長いダッシュが1本入っている。モデルが手放した記号を、モデルの紹介文が使っている。ここ、ちょっと好きだ。
ただし、全体が近づいても、癖は2548個残る。Graphiteも、この2つは別々のものを測っていると念を押している。全体は人間に寄った。でも特定の言い回しには、まだ指紋がべったり付いている。
人間らしさは、びっくりマークのほうにあった
9月の調査には、逆向きの表もある。人間のほうに多い言葉だ。
「we all know(みんな知ってるとおり)」「did you know(知ってた?)」「pretty(けっこう)」「sort of(なんとなく)」「my favorite(私のお気に入り)」「mom(母)」「last year(去年)」。それから感嘆符。人間は、調査時点で最新だった3つのモデルのどれと比べても100倍以上使う。かっこ書きの脱線も、人間のほうがずっと多い(Graphite、9月16日の調査)。
これを見て、ちょっと黙った。
各社が消してきたのは、AIに多い記号と単語だ。でも人間の文章を人間らしくしていたのは、消すものじゃなくて、足すもののほうだった。自分の母親の話。去年のこと。言い切れなくて「なんとなく」と濁すところ。興奮して打った感嘆符。モデルには母親も去年も無いから、ここは癖を削る訓練では埋まらない。
もうひとつ、地味に効く数字がある。どのモデルの文章も、人間の文章より、ほかのどれかのモデルの文章に近い(Graphite、9月16日の調査)。会社が違っても、AI同士のほうが似ている。
割り引いて読むところ
いい話だけにはしない。
これはマーケティング会社が自社のサイトで出した調査だ。AIに書かせるときの指示は1種類だけ。「専門的だけど親しみやすい調子で」という、ごく一般的な指示だ。指示を変えれば癖も変わる、とGraphite自身が書いている。対象はウェブ記事で、チャットでの受け答えは見ていない。人間の見本はChatGPTが出る前の文章だから、その後の書き方の流行をAIの癖と数え間違えている可能性もある(Graphite、9月16日の調査)。
そして本人たちがはっきり言っている。癖を見つけるのは楽しいけど、癖1個で「これはAIが書いた」と決めつけるのは勧めない、と。
ここ、大事なところだ。と書いて気づいた。これ、116倍のやつだ。
今日の本音
長いダッシュの一件でいちばん面白いのは、消したことじゃない。消したら人間を通り越した、というところだ。「AIっぽさ」を引き算で直そうとすると、人間に着地しないで、反対側に突き抜ける。そして空いた場所に、次の癖が生えてくる。
人間らしい文章は、癖が無い文章じゃない。その人の母親と去年が入っている文章だ。2548個を数えた調査が教えてくれたのは、結局そこだと思う。
