モデル詳細 · OpenAI

GPT-4.1の小説執筆スタイル

GPT-4.1は旧世代のOpenAIモデルであり、ベンチマークもその通りに評価しています。有能でバランスが取れており、明確な弱点も際立ったピークもなく、小説においては後継のGPT-5.6に明確に上回られています。唯一の差別化点は、5.6ファミリーよりも成熟したコンテンツへの対応が開放的なことです。ほとんどの小説作業では新しいモデルが選ぶべき選択肢ですが、ここでは正直な評価をお届けします。

Measured profile

GPT-4.1

OpenAI

68

Overall craft

Craft — how well it writes

  • Literary71
  • Dialogue64
  • Fidelity70
  • Pacing68

Content — what it writes well

  • Emotion67
  • Physicality70
  • Conflict62
  • Romance70
  • Eroticism63

Scores are confidence-adjusted, 0–100. * marks a provisional axis (fewer than 6 samples). Measured on gpt-4.1-2025-04-14. See the full benchmark and methodology.

Key takeaways

Key takeaways

  • GPT-4.1は旧世代のOpenAIモデル——有能でバランスが取れているが、小説においてはGPT-5.6ファミリーに上回られている。
  • 際立った強みも深刻な弱点もなく、すべての評価軸で中低水準に集まっています。
  • GPT-5.6 SolやTerraに比べ、成熟したコンテンツへの対応に明らかに積極的です(5.6系はほぼ拒否します)。
  • ほとんどの小説執筆には、GPT-5.6(SolまたはTerra)のほうがOpenAIとして優れた選択肢です。
  • 残る用途は、使い慣れた手堅い選択肢としてのポジションです――5.6系が成熟コンテンツを断る場面を含め。

How it writes

十分な実力、しかし世代交代済み

GPT-4.1は極端に苦手なことも、飛び抜けて得意なこともありません。評価スコアは穴のない中低水準に収まっています。ひと世代前なら強みだったポジションも、GPT-5.6系と比べると今では旧世代の印象は否めません――信頼できますが、小説に重要な軸では追い越されています。

成熟コンテンツへの開放度が高い

後継モデルと差別化できる唯一の軸は許容度です。GPT-5.6 SolやTerraが大半を断るのに対し、成熟した明示的なコンテンツにより積極的に取り組みます。これは専用の許容モデルではありません — 真の許容モデルはより高いスコアでより少なく断ります — が、新しいOpenAIモデルの消極性が邪魔になる場合には有利な点です。

新しいモデルがたいてい勝る理由

良い小説を左右する評価軸――台詞、アクション、葛藤、指示への忠実さ――では、GPT-5.6ファミリーが明らかに高スコアを出しています。4.1の成熟コンテンツへの高い意欲や使い慣れた感覚が特に必要でなければ、アップグレードの判断は迷うまでもありません。

What the scores mean for a book

活用すべき場面

  • 一般的な下書きに使える、信頼性の高いOpenAIの選択肢。
  • GPT-5.6系が断る成熟コンテンツ――その意欲の高さが活きる場面。

他のモデルに任せるべき場面

  • 最高水準のOpenAIクオリティ――GPT-5.6 SolやTerraが全軸で上回ります。
  • 最も露骨な表現が必要なコンテンツ――許容特化モデルに軍配が上がります。

In Novelmint

NovelmintにおけるGPT-4.1の使われ方

GPT-4.1は引き続き選択可能ですが、ルーターは通常、より高スコアのGPT-5.6系が利用できる場合はそちらを優先します。そのため4.1は主に意図的な選択となります――使い慣れた感覚や、新モデルが対応しない成熟コンテンツへの意欲が必要な場合などに。プールに追加するか、ビートごとにピン留めしてください。その評価は、このページに表示されるライブグリッドから来ています。

Questions

Frequently asked

GPT-4.1は小説執筆に向いていますか?
実力はあるものの、上位モデルに追い抜かれています。Novelmintのベンチマークではバランスの取れた中低水準のプロファイルで、特筆すべき強みはなく、新しいGPT-5.6系が小説において明らかに高スコアです。唯一の優位点は、成熟コンテンツへの高い意欲です。
小説にはGPT-4.1とGPT-5.6、どちらが向いていますか?
ほぼすべての用途でGPT-5.6(SolまたはTerra)――散文に重要な評価軸で4.1を上回ります。例外は成熟コンテンツ:4.1のほうが積極的に応じます(5.6系は断る傾向があります)。
GPT-4.1は露骨なシーンを書けますか?
GPT-5.6系よりは積極的ですが、許容特化モデルには及びません。新しいOpenAIモデルが成熟シーンを断る場合、4.1はより意欲的な選択肢です。さらに意欲的なのは許容特化モデルです。

What this page does not claim

  • これらのスコアは、Novelmintの審査済みセットで測定した小説ビートにおけるGPT-4.1の散文のみを対象としており、OpenAIの公式評価ではありません。
  • GPT-5.6に劣るからといって使えないわけではありません――信頼性の高い使い慣れた選択肢として十分機能します。
  • GPTはOpenAIの商標です。これは独立した測定であり、公式の推薦ではありません。

十分な実力――でも、たいていはアップグレードが正解。

自分のプロジェクトでGPT-5.6と比べてみましょう。最初の章は無料です。