ChatGPT vs Claude vs Gemini:どのAIが最も人間らしく書くのか?
GPT-5.2、Claude Sonnet 4.5、Gemini 3 Proの320サンプルをライティングスタイル6次元で計測。2026年、あなたに最も近いAIはどれか。
By Emmanuel
毎週のように「ChatGPT vs Claude vs Gemini」比較記事が公開されています。そのほとんどは、トリビアへの回答精度、コードの生成量、指示への追従度を比較しています。
どのモデルが最も人間らしく書くかを測定したものは、ほとんどありません。
私たちはそれを実行しました。意見ではなく、データで。
測定対象
5つのAIモデル、8種類のプロンプト、4言語で320のライティングサンプルを生成しました。今回の比較では、多くのプロフェッショナルが日常的に選択する3モデルに焦点を当てます。GPT-5.2(ChatGPT)、Claude Sonnet 4.5(Claude)、Gemini 3 Pro(Gemini)です。
各サンプルを計算文体論で分析しました。ライティングスタイルの6つの独立した次元を測定する決定論的な数式です。Writing DNA スナップショットで人間の文章に適用しているのと同じ数式なので、公平な比較が可能です。
方法論の詳細:「平均的なAI」の測定方法。5モデルすべての詳細分析:各AIモデルの文体を徹底比較。
直接対決:6つの次元
文の複雑さ
| モデル | スコア |
|---|---|
| Gemini 3 Pro | 最高 |
| Claude Sonnet 4.5 | 中間 |
| GPT-5.2 | 3モデル中最低 |
Geminiは最も構造的に複雑な文を書きます。入れ子構造の従属節、修飾語、複数パートの構造を用いた、よく編集されたレポートのような出力です。Claude Sonnetは中間に位置し、プロフェッショナルな文脈に十分な複雑さを持ちつつ、読みやすさも確保しています。GPT-5.2は3モデル中最も読みやすい文構造を生み出し、密度よりも明快さを重視しています。
あなたにとっての意味: 自然に短く直接的な文を書く方(複雑さ50未満)にはGPT-5.2が最も近い出発点です。密度の高い文を書く方(70以上)にはGeminiが近い。多くのプロフェッショナルはその中間で、Sonnetが位置する領域です。
語彙の幅
| モデル | スコア |
|---|---|
| Claude Sonnet 4.5 | 最高 |
| GPT-5.2 | 中間 |
| Gemini 3 Pro | 最低 |
Claude Sonnetは3モデル中最も幅広い語彙を使い、一般的な表現よりも的確な用語をより頻繁に選択します。GPT-5.2は中間で、親しみやすいが単調ではありません。Gemini 3 Proはより語彙の再利用が多く、多様性よりも用語の一貫性を重視しています。
あなたにとっての意味: 専門的な語彙を持つライター――テクニカルライター、研究者、専門家――はGeminiとの差が最も大きくなります。幅広い読者向けに書くコミュニケーターは、モデル間の差をあまり感じないかもしれません。
表現力
| モデル | スコア |
|---|---|
| GPT-5.2 | 最高(大差で) |
| Claude Sonnet 4.5 | 中間 |
| Gemini 3 Pro | 最低 |
この軸でモデル間の差が最も顕著に現れます。GPT-5.2は圧倒的に表現力の高いAIライターです。修辞的疑問、感嘆符、態度マーカー(「重要なことに」「興味深いことに」)、強調的な句読点を他の2モデルより大幅に多く使用します。
Claude Sonnetは中程度の表現力で、熱心だが過剰ではありません。Gemini 3 Proは最も抑制的で、エネルギッシュというより情報伝達的な文章を書きます。
あなたにとっての意味: この軸は、ユーザーが理由を言語化する前にどのモデルが「しっくりくる」かを決める要因になることが多いです。ChatGPTの出力がプロフェッショナルな文脈に対して熱心すぎると感じたなら、データがその直感を裏付けています。Claudeの出力が落ち着いてバランスが取れていると感じたなら、それも測定可能です。Geminiの出力がドライに感じたなら、同じく。
フォーマリティ
| モデル | スコア |
|---|---|
| Gemini 3 Pro | 最高 |
| Claude Sonnet 4.5 | 中〜高 |
| GPT-5.2 | 最低 |
Geminiは最もフォーマルに書きます。機能語の多用、慎重なヘッジ、セミコロンが特徴です。Claude Sonnetは堅苦しさのないプロフェッショナルなフォーマリティを維持します。GPT-5.2は会話的な傾向があり、特にカジュアルさを許容するプロンプトではその傾向が強まります。
あなたにとっての意味: 法務、金融、エグゼクティブのコミュニケーションは一般的に高いフォーマリティを要します。Geminiのデフォルトがそのレジスターに最も近いです。マーケティング、営業、チーム内コミュニケーションは低いフォーマリティの方が効果的なことが多く、GPT-5.2が適しています。Claude Sonnetはその中間です。
一貫性
| モデル | スコア |
|---|---|
| Claude Sonnet 4.5 | 最高 |
| Gemini 3 Pro | 中間 |
| GPT-5.2 | 最低 |
Claude Sonnetは最も均一な文長を生み出します。安定した、予測可能なリズムです。GPT-5.2は最もバリエーションが大きく、短くパンチの効いた文と長い説明文が交互に現れます。
あなたにとっての意味: 予測可能なリズムの文章を書く方(法律文書やテクニカルライティングに多い)にはClaude Sonnetの一貫性が最も近い。「バースト的」な文章――効果を狙って長短を使い分ける――を書く方にはGPT-5.2の変動性が良い出発点です。
簡潔さ
| モデル | スコア |
|---|---|
| GPT-5.2 | 最高(ただし50未満) |
| Claude Sonnet 4.5 | 中間 |
| Gemini 3 Pro | 最低 |
簡潔に書けるモデルは存在しません。これは明確に述べておくべきことです。すべての主要AIモデルが、同じ文脈で大半のプロフェッショナルが書くよりも長い出力を生成します。 全体の平均は100点中42で、それを大幅に超えるモデルはありません。
GPT-5.2は他よりわずかに簡潔です。会話的なスタイルが自然と短い文を生みます。Geminiは最も簡潔さが低く、高い複雑さと長い文長が組み合わさっています。
あなたにとっての意味: 簡潔なライター(多くのプロフェッショナルがそう)であれば、この軸ではすべてのモデルに大幅なキャリブレーションが必要です。モデル選択ではほとんど差は出ません。
スコアカード
AI Model Writing Style Comparison
Comparing Claude Opus 4.6 vs GPT-5.2 in English
勝敗をまとめましょう。
| 次元 | 勝者 |
|---|---|
| 文の複雑さ | あなたのスタイル次第 |
| 語彙の幅 | Claude Sonnet 4.5 |
| 表現力 | あなたのスタイル次第 |
| フォーマリティ | あなたのスタイル次第 |
| 一貫性 | Claude Sonnet 4.5 |
| 簡潔さ | GPT-5.2(僅差) |
パターンに注目してください。3つの次元には普遍的な勝者がいません。「最良」のスコアは、あなたがその軸のどこに位置するかに完全に依存します。 高い複雑さが低い複雑さより優れているわけではありません。高い表現力が低い表現力より優れているわけでもありません。高いフォーマリティも同様です。
問いは「どのモデルが最も上手く書くか」ではありません。「どのモデルのデフォルトが各次元で自分の文章に最も近いか」です。
では、どのモデルが最も人間らしく書くのか?
正直な答え:どれも該当しない。そして、すべてが該当する。
どれも該当しないのは、すべてのモデルが実在の人間が占めることのない統計的な中心に収束するからです。メディアンユーザー問題は3モデルすべてに等しく影響します。各モデルの出力は、個性的な人間のライターとの類似度よりも、互いの類似度の方が高い。だからAIの文章は画一的に聞こえるのです。
すべてが該当するのは、各モデルに特定の人間スタイルに近い次元があるからです。
- GPT-5.2は、表現力豊かで会話的、リズムに変化のある書き手に最も近い。マーケティングリーダー、営業担当、コミュニティマネージャーを想像してください。(参照:ChatGPTを仕事で使う)
- Claude Sonnet 4.5は、バランスの取れたプロフェッショナルで一貫性のある書き手に最も近い。プロジェクトマネージャー、コンサルタント、オペレーションリーダーを想像してください。(参照:Claudeにあなたのように書かせる)
- Gemini 3 Proは、フォーマルで構造的、徹底的な書き手に最も近い。弁護士、アナリスト、エグゼクティブコミュニケーターを想像してください。(参照:Geminiにあなたのように書かせる)
ただし、これらの一致は部分的です。GPT-5.2はマーケターの表現力に合っても、簡潔さは完全に外すかもしれません。Claude Sonnetはコンサルタントのフォーマリティに合っても、文構造を過度に複雑化するかもしれません。6次元すべてで完全に一致することはありません。各モデルの完全な個性プロファイルはすべてのAIモデルのライティングプロファイルをご覧ください。
本当の答え:選ぶのではなく、キャリブレーションする
データから得られる直感に反する結論は、モデル選択よりもモデルのキャリブレーションの方が重要だということです。
いずれの軸でも、2モデル間の最大差はおよそ16ポイント。モデルのデフォルトと人間の実際のスタイルとの典型的なギャップは、複数の軸で同時に20-40ポイントです。
ChatGPTからClaudeに切り替えると、フォーマリティで10ポイント近づくかもしれません。しかし簡潔さでは25ポイント、表現力では30ポイント、一貫性では15ポイント離れたまま。1つの次元を最適化し、4つは未調整のままです。
スタイルプロファイルは、どのモデルを使っていても6次元すべてを同時にキャリブレーションします。あなたの実際の文章を測定し、モデルのデフォルトとの差分を計算し、各次元の具体的な目標値をAIに与えます。
モデルはキャンバスです。スタイルプロファイルは指示書です。どのキャンバスでも構いません。重要なのは指示の精度です。
異なる言語ではどうなるか?
今回の比較は英語に焦点を当てています。他の言語ではモデルのダイナミクスが変化し、時には劇的に変わります。日本語のAI出力は英語とは大きく異なり、各モデルの相対的な強みも言語によって変化します。
言語間の違いについてはAIが言語ごとにどう異なる文章を書くかをご覧ください。言語別のモデル推奨については言語ごとに最適なAIモデルをご参照ください。
あなたに最も近いモデルを見つける
どのモデルのデフォルトがあなたの文章に最も近いか知りたいですか? 無料のWriting DNA スナップショットをお試しください。6次元すべてであなたのスタイルをマッピングし、平均的なAIとのギャップを表示します。
スナップショットはどのモデルを使うべきかは教えません。より有用なことを教えてくれます。あなたのように書くために、どのモデルであっても何を変える必要があるのか、正確に。
AIにあなたらしい文章を書かせる
手作業でAIの出力を調整する方法を読んだところで、MyWritingTwinなら実際の文章から自動で行えます。サンプルをいくつか貼り付けるだけで、ChatGPT・Claude・Geminiで使えるボイスプロファイルが完成します。
無料でプロファイルを作成まだ早い?AIボイスプロファイルのガイドをメールでお届けします。