AIモデルごとの文章の違い:データに基づく比較分析
Claude Opus、Claude Sonnet、Claude Haiku、GPT-5.2、Gemini 3 Proに同じプロンプトを実行し、文章スタイルの6つの次元を計測しました。その結果は驚くべきものでした。
By Emmanuel
Claude、ChatGPT、Geminiに同じメールの作成を依頼すると、明らかに異なる3つのテキストが出力されます。一つは慎重で抑制の効いた文章。もう一つは心から手助けしたいという熱意が感じられる文章。そして3つ目は、まるで政府の報告書を書いているかのような文章です。
これらの違いはランダムではありません。数百のサンプルにわたって定量化可能で、再現可能で、一貫しています。私たちが計測したからこそ、断言できます。
5つのモデル、同じ320のプロンプト
5つのAIモデル — Claude Opus 4.6、Claude Sonnet 4.5、Claude Haiku 4.5、GPT-5.2、Gemini 3 Pro — に同一の執筆タスクを与えました。フォーマルなメール、カジュアルなメール、ビジネスレポート、SNS投稿、ブログ記事の導入部、Slackメッセージ、プレゼンテーションノート、会議のフォローアップ。8種類のプロンプトタイプ、4言語、各2パターン。モデルあたり320サンプルです。
すべてのサンプルを計算文体論で分析しました。これは6つの独立した次元で文章を評価する決定論的な数式です。人間のライティングDNAスナップショットを作成するのと同じ分析手法を、AIの出力に適用したものです。
結果として得られたのは、各モデルの文章の指紋です。「どれが優れているか」ではなく、「それぞれがどのように書くか」を示すものです。
計測した6つの次元
| 次元 | 計測内容 | スケール |
|---|---|---|
| 文の複雑さ | 構造的密度 — 長く入れ子になった文ほど高得点 | 0-100 |
| 語彙の豊富さ | 語彙多様性 — ユニークな単語が多いほど高得点 | 0-100 |
| 表現力 | レトリカルなエネルギー — 疑問文、感嘆符、強調マーカー | 0-100 |
| フォーマル度 | 機能語、ヘッジ表現、慎重な構造 | 0-100 |
| 一貫性 | 文の長さの均一性 — 安定したリズム vs 動的な変化 | 0-100 |
| 簡潔さ | 文の長さの逆数 — 短い文ほど高得点 | 0-100 |
各軸は独立しています。フォーマル度が高く簡潔さが低いモデルもあれば、表現力は高いが一貫性が低いモデルもあります。この組み合わせが個性を形成します。
結果:5つのモデル、5つの個性
Claude Opus 4.6 — 「設計者」
Opusはテストしたすべてのモデルの中で最も長く、構造的に複雑な文を生成します。慎重にヘッジし、精密な語彙を展開し、プロンプトがカジュアルな表現を求めてもフォーマルなレジスターから外れることはめったにありません。フォーマル度と語彙の豊富さは高スコア。簡潔さは低スコアです。
最適な用途: 綿密な分析、詳細なレポート、精度が簡潔さより重要な繊細な議論。
注意点: おそらく削る必要があります。Opusはデフォルトで「短く」書きません。
Claude Sonnet 4.5 — 「万能選手」
Sonnetはすべての次元で中間に位置し — それが強みです。適度な複雑さ、適度なフォーマル度、適度な表現力。Opusよりもプロンプトの種類に柔軟に対応し、メールからSlackメッセージへのレジスター切り替えがスムーズです。
最適な用途: 日常的なビジネスコミュニケーション。ほとんどの人が日々必要とするメール、報告、メッセージ。
注意点: 「バランスが良い」は「個性がない」を意味することも。Sonnetの汎用性は個性とのトレードオフです。
Claude Haiku 4.5 — 「簡潔家」
Haikuは短く書きます。簡潔さのスコアは他のモデルを大きく上回ります。語彙の豊富さはそれに伴い下がります — Haikuは精密な用語より馴染みのある言葉を選びます。
驚きだったのはHaikuの表現力です。短い文にもかかわらず、疑問文、感嘆符、態度マーカーを自由に使います。素っ気ないのではなく、歯切れが良い文章です。
最適な用途: Slackメッセージ、素早い返信、「要点だけ」が求められるすべての場面。
注意点: 複雑な議論はHaikuの圧縮レベルではニュアンスが失われます。
GPT-5.2 — 「熱血家」
GPT-5.2は表現力で際立ちます。修辞的な疑問、感嘆符、温かみのある言葉を他のどのモデルよりも自由に使います。ChatGPTの出力が「温かい」と感じるなら、データがその直感を裏付けています。
文のリズムが最もダイナミックで — 文の長さの変化が大きく、会話的な流れを生み出します。フォーマル度は平均以下。語彙は堅実ですが突出はしていません。
最適な用途: マーケティングコピー、SNS、説得力のあるコンテンツ、エネルギーと熱意が活きるすべて。
注意点: 抑制が求められるビジネスの場面で、GPT-5.2の熱意は場違いに映ることがあります。
Gemini 3 Pro — 「報告書作成者」
Geminiは密度の高い構造的な文章を書きます。文の複雑さは高く(Opusに近い)、表現力は低い。フォーマル度のスコアは最高レベル — 機能語の多用、慎重なヘッジ、抑制の効いたトーン。
Geminiの出力は、よく編集された報告書のように読めます。プロフェッショナルで、徹底的で、慎重です。
最適な用途: ビジネスレポート、規制文書、制度的な文章。
注意点: カジュアルなコンテンツは堅く感じます。明確な指示がなければ、Geminiは「会話調」になりません。
比較表
| 次元 | Opus | Sonnet | Haiku | GPT-5.2 | Gemini 3 Pro | AI平均 |
|---|---|---|---|---|---|---|
| 文の複雑さ | 高 | 中 | 低 | 中 | 高 | 65 |
| 語彙の豊富さ | 高 | 中 | 低 | 中 | 中 | 48 |
| 表現力 | 低 | 中 | 中-高 | 非常に高 | 低 | 76 |
| フォーマル度 | 高 | 中 | 中 | 平均以下 | 高 | 58 |
| 一貫性 | 高 | 中 | 中 | 低 | 中-高 | 53 |
| 簡潔さ | 低 | 中 | 高 | 中 | 低 | 42 |
3つのパターンが浮かび上がります:
表現力が最大の差別化要因。 GPT-5.2(非常に高い)とGemini/Opus(低い)の差は、すべての次元で最大の乖離です。トーンが重要なら、ここがモデル選択で最も影響する部分です。
簡潔さがClaude内部を分ける。 Haikuの簡潔さはOpusを大きく上回ります。同じ企業、同じ訓練哲学、劇的に異なる出力長。モデルサイズが冗長さに直結しています。
フォーマル度は二極化。 Opus、Gemini、(やや控えめに)Sonnetはフォーマルに書きます。GPT-5.2とHaikuはカジュアルに書きます。中間がありません。
これが実務で意味すること
ほとんどのAI比較記事が見落としている実践的なポイント:選んだモデルが、そのモデルで作成するすべての成果物のデフォルトの個性を決定します。
ChatGPTでビジネスメールを書けば、メールはデフォルトで熱意があり表現豊か — 抑制の効いた簡潔さが欲しい時でも。Geminiを使えば、Slackメッセージはデフォルトでフォーマルで密度が高い — 軽くて素早いメッセージが欲しい時でも。
多くの人はプロンプトで修正しようとします。「もっと簡潔に。」「もっとプロフェッショナルに。」それは多少助けになります。しかしモデルの訓練と戦っているのであり、会話のたびにゼロからやり直しています。
データが示す別のアプローチ:
-
デフォルトが自分のスタイルに最も近いモデルを選ぶ。 簡潔に書く人ならHaikuから。表現豊かに書く人ならGPT-5.2が近い出発点です。
-
具体的なギャップを把握する。 「もっと自分らしく書いて」ではなく、データが示すどの次元を調整すべきかを知ること。
-
都度の修正ではなくスタイルプロファイルを使う。 ライティングDNAスナップショットは6つの次元すべてであなたのスタイルを計測し、モデルのデフォルトと比較します。スコアの差が再利用可能な指示セットになります。
あなたの文章がどう比較されるか確認する
自分の文章がこの6つの次元でどこに位置するか気になりますか? 無料のライティングDNAスナップショットを試してみてください — いくつかの文章サンプルを提出すると、上記のAIモデルと自分のスタイルがどう異なるかが正確にわかります。
クレジットカード不要。あなたの文章だけで十分です。
AIにあなたらしい文章を書かせる
手作業でAIの出力を調整する方法を読んだところで、MyWritingTwinなら実際の文章から自動で行えます。サンプルをいくつか貼り付けるだけで、ChatGPT・Claude・Geminiで使えるボイスプロファイルが完成します。
無料でプロファイルを作成まだ早い?AIボイスプロファイルのガイドをメールでお届けします。