指示に従うのが最も得意なAI
Live data · ranked by Fidelity · measured as of August 31, 2026
アウトラインを元に執筆する場合、モデルに最も求められることは、指示通りに動くことです――必要な要素を含め、非公開の知識を持ち込まず、作り話に逸れないこと。このランキングはフロンティアモデルのその忠実度をスコア化します。長編フィクションでは、華やかさより忠実度の方が静かに重要です。毎ビートでずれるモデルは、常に再整合が必要な原稿を生み出します。
Key takeaways
- モデルは測定された忠実度――ブリーフされたビートをどれだけ忠実に再現するか――で、実際の小説散文を基にランク付けされています。
- Claude Opus 4.8は忠実度で大差をつけてリードしており、これが本の主要な声として機能する中心的な理由です。
- 高い忠実度は小説全体で積み重なります――計画した構成が実際に保たれ、毎ビートで少しずつずれることがありません。
- ランキングはライブで、より多くの散文が測定されるにつれて更新されます。
The ranking
Ranked by Fidelity
測定された忠実度で高い順にランク付け。スコアは各モデルの忠実度軸における信頼度調整済みの値(0〜100)です。
- Claude Opus 4.8Anthropic91
忠実度で大差をつけてリードします。渡されたビートをほぼ完全に忠実に実行し――安定した主要な声として最も有用な特性です。
- Claude Opus 5Anthropic · Novelmint Lead89
- GPT-5.6 SolOpenAI83
ブリーフに対して強力で安定しており、アクションとコンフリクトのリードにも加わります。
- GPT-5.6 TerraOpenAI80
- Gemini 3.5 FlashGoogle80
最もサンプルが多い強みは忠実度で、この高速・低コストモデルを大量ドラフトの信頼できるワークホースにしています。
- Claude Sonnet 5Anthropic79
- Gemini 3.6 FlashGoogle78
- Gemini 3.1 ProGoogle77
- Grok 4.5xAI75
- Grok 4.3xAI74
- Fable 5Anthropic73
このストーリーテリングモデルはブリーフへの拘束がやや緩め――それがページ上の生命力の源となることも多いですが、継続性が重要なビートではより明確なプロンプトが必要になることもあります。
- GPT-4.1OpenAI70
- Claude Haiku 4.5Anthropic64
How this ranking is made
ブリーフ通りの実行でスコア付け
各モデルは同じブリーフされたビートを書きます — 必須要素、禁止知識、視点を含む — そして盲目審査パネルが、著者を知らずにその契約をどれだけ忠実に散文が守るかを評価します。サンプルが少ない場合は中立ベースラインに縮小されます。このページはその一軸でモデルを順位付けします。
See the full nine-axis benchmark and methodologyQuestions
Frequently asked
- 執筆ブリーフに最も忠実なAIはどれですか?
- Claude Opus 4.8はNovelmintベンチマークの忠実度測定で大差をつけてリードしており――ずれや創作が最も少ない状態でブリーフされたビートを再現します。ライブランキングで全体の順位をご確認ください。
- 小説において忠実度が重要なのはなぜですか?
- 毎ビートで少しずつずれるモデルは、常に再整合が必要な原稿を生み出します。高い忠実度があれば計画した構成が保たれ、編集が定着し、継続性が維持されます。
- 忠実度の高いモデルは創造性が低いですか?
- 必ずしもそうではありません――忠実度はブリーフへの誠実さを測るものであり、平凡さではありません。Opusは忠実度と文学クラフトの両方でリードしています。Fableのような自由度の高いモデルは解放感を与えることもありますが、それは時に強みとなり、時にずれとなります。
What this page does not claim
- これはフィクションのビートのみで測定された忠実度のランキングです。
- ブリーフへの忠実度は9つの軸のひとつです。あなたの作品に必要な他の軸も確認してください。
- モデル名はそれぞれの所有者の商標です。これは独立した測定結果です。