模型深度解析 · OpenAI

GPT-4.1 的小说写作表现

GPT-4.1 是上一代 OpenAI 模型,基准测试对其的定位与此相符:能力尚可,表现均衡,没有明显短板也没有突出峰值,在小说写作上已被 GPT-5.6 系列明显超越。它唯一的差异化之处在于,相比 5.6 系列,它更愿意处理成人内容。对于大多数小说写作任务,更新的模型是更好的选择,但这里给出客观的评价。

Measured profile

GPT-4.1

OpenAI

68

Overall craft

Craft — how well it writes

  • Literary71
  • Dialogue64
  • Fidelity70
  • Pacing68

Content — what it writes well

  • Emotion67
  • Physicality70
  • Conflict62
  • Romance70
  • Eroticism63

Scores are confidence-adjusted, 0–100. * marks a provisional axis (fewer than 6 samples). Measured on gpt-4.1-2025-04-14. See the full benchmark and methodology.

Key takeaways

Key takeaways

  • GPT-4.1 是上一代 OpenAI 模型——能力尚可,表现均衡,但在小说写作上已被 GPT-5.6 系列超越。
  • 它没有突出的强项,也没有明显的弱点;在各写作维度上,整体处于中低水平。
  • 在成人内容方面,它的接受度明显高于 GPT-5.6 Sol 和 Terra——后两者大多会拒绝此类请求。
  • 对于大多数小说创作,GPT-5.6(Sol 或 Terra)在写作质量上是更好的 OpenAI 选择。
  • 它剩余的细分优势在于:作为一个熟悉、可靠的选项——尤其是在 5.6 系列对成人内容的保守态度成为问题时。

How it writes

称职,但已被超越

GPT-4.1 没有明显短板,也没有突出亮点。其写作评分处于中低区间,无明显缺陷,也无特别出彩之处。这在上一代曾是不错的定位;但与 GPT-5.6 系列相比,它如今显得更为陈旧——可靠,却在关键写作维度上已落后于人。

对成人内容更为开放

与后续版本相比,它唯一突出的维度是宽松度:它比 GPT-5.6 Sol 和 Terra 更愿意处理成熟和露骨内容,后者大多数情况下会拒绝。这并不意味着它是专门的宽松模型——真正的宽松模型得分更高、拒绝更少——但当新版 OpenAI 模型的抵触成为障碍时,这一点确实是它的优势。

为何新版模型通常更胜一筹

在驱动优质小说的写作和内容维度上——对话、动作、冲突、忠实于创作简报——GPT-5.6 系列的表现明显更优。除非你明确需要 4.1 对成人内容更高的接受度或对其更为熟悉,否则升级是显而易见的选择。

What the scores mean for a book

适合用于

  • 熟悉可靠的 OpenAI 通用写作选项。
  • GPT-5.6 系列会拒绝的成人内容——此时它更高的接受度有所帮助。

建议改用其他模型

  • 追求顶级 OpenAI 写作质量时——GPT-5.6 Sol 或 Terra 在各方面均优于它。
  • 最露骨的内容——专业宽松模型在此更胜一筹。

In Novelmint

Novelmint 如何使用 GPT-4.1

GPT-4.1 仍可选用,但路由器通常会在 GPT-5.6 系列可用时优先选择评分更高的它们,因此 4.1 大多是主动选择——出于熟悉感,或因新版模型在成人内容上的不足。你可以将其加入模型池,或按章节固定使用;其排名来自本页实时渲染的评测网格。

Questions

Frequently asked

GPT-4.1 适合用于小说写作吗?
它称职,但已被超越。在 Novelmint 基准测试中,它呈现出均衡的中低水平表现,无突出强项,而新版 GPT-5.6 系列在小说写作上的评分明显更高。它唯一的优势在于对成人内容更高的接受度。
小说写作选 GPT-4.1 还是 GPT-5.6?
几乎所有场景都推荐 GPT-5.6(Sol 或 Terra)——它们在关键写作和内容维度上均优于 4.1。例外情况是成人内容:4.1 对此更为接受,而 5.6 系列通常会拒绝。
GPT-4.1 能写露骨场景吗?
比 GPT-5.6 系列更容易接受,但仍不及专业宽松模型。如果 OpenAI 新版模型拒绝处理成人场景,4.1 是更愿意配合的选项,而宽松模型则更进一步。

What this page does not claim

  • 这些评分仅描述 GPT-4.1 在小说场景中的散文表现,以 Novelmint 评测集为基准——并非 OpenAI 官方评级。
  • 被 GPT-5.6 超越并不意味着它无法使用——它仍是一个可靠、熟悉的选项。
  • GPT 是 OpenAI 的商标;本测评为独立评测,并非官方背书。

称职可用——但升级通常是更明智的选择。

在你自己的创作中与 GPT-5.6 对比。第一章免费。