GPT-4.1 的小说写作表现
GPT-4.1 是上一代 OpenAI 模型,基准测试对其的定位与此相符:能力尚可,表现均衡,没有明显短板也没有突出峰值,在小说写作上已被 GPT-5.6 系列明显超越。它唯一的差异化之处在于,相比 5.6 系列,它更愿意处理成人内容。对于大多数小说写作任务,更新的模型是更好的选择,但这里给出客观的评价。
Measured profile
GPT-4.1
OpenAI
68
Overall craft
Craft — how well it writes
- Literary71
- Dialogue64
- Fidelity70
- Pacing68
Content — what it writes well
- Emotion67
- Physicality70
- Conflict62
- Romance70
- Eroticism63
Scores are confidence-adjusted, 0–100. * marks a provisional axis (fewer than 6 samples). Measured on gpt-4.1-2025-04-14. See the full benchmark and methodology.
Key takeaways
Key takeaways
- GPT-4.1 是上一代 OpenAI 模型——能力尚可,表现均衡,但在小说写作上已被 GPT-5.6 系列超越。
- 它没有突出的强项,也没有明显的弱点;在各写作维度上,整体处于中低水平。
- 在成人内容方面,它的接受度明显高于 GPT-5.6 Sol 和 Terra——后两者大多会拒绝此类请求。
- 对于大多数小说创作,GPT-5.6(Sol 或 Terra)在写作质量上是更好的 OpenAI 选择。
- 它剩余的细分优势在于:作为一个熟悉、可靠的选项——尤其是在 5.6 系列对成人内容的保守态度成为问题时。
How it writes
称职,但已被超越
GPT-4.1 没有明显短板,也没有突出亮点。其写作评分处于中低区间,无明显缺陷,也无特别出彩之处。这在上一代曾是不错的定位;但与 GPT-5.6 系列相比,它如今显得更为陈旧——可靠,却在关键写作维度上已落后于人。
对成人内容更为开放
与后续版本相比,它唯一突出的维度是宽松度:它比 GPT-5.6 Sol 和 Terra 更愿意处理成熟和露骨内容,后者大多数情况下会拒绝。这并不意味着它是专门的宽松模型——真正的宽松模型得分更高、拒绝更少——但当新版 OpenAI 模型的抵触成为障碍时,这一点确实是它的优势。
为何新版模型通常更胜一筹
在驱动优质小说的写作和内容维度上——对话、动作、冲突、忠实于创作简报——GPT-5.6 系列的表现明显更优。除非你明确需要 4.1 对成人内容更高的接受度或对其更为熟悉,否则升级是显而易见的选择。
What the scores mean for a book
适合用于
- 熟悉可靠的 OpenAI 通用写作选项。
- GPT-5.6 系列会拒绝的成人内容——此时它更高的接受度有所帮助。
建议改用其他模型
- 追求顶级 OpenAI 写作质量时——GPT-5.6 Sol 或 Terra 在各方面均优于它。
- 最露骨的内容——专业宽松模型在此更胜一筹。
In Novelmint
Novelmint 如何使用 GPT-4.1
GPT-4.1 仍可选用,但路由器通常会在 GPT-5.6 系列可用时优先选择评分更高的它们,因此 4.1 大多是主动选择——出于熟悉感,或因新版模型在成人内容上的不足。你可以将其加入模型池,或按章节固定使用;其排名来自本页实时渲染的评测网格。
Questions
Frequently asked
- GPT-4.1 适合用于小说写作吗?
- 它称职,但已被超越。在 Novelmint 基准测试中,它呈现出均衡的中低水平表现,无突出强项,而新版 GPT-5.6 系列在小说写作上的评分明显更高。它唯一的优势在于对成人内容更高的接受度。
- 小说写作选 GPT-4.1 还是 GPT-5.6?
- 几乎所有场景都推荐 GPT-5.6(Sol 或 Terra)——它们在关键写作和内容维度上均优于 4.1。例外情况是成人内容:4.1 对此更为接受,而 5.6 系列通常会拒绝。
- GPT-4.1 能写露骨场景吗?
- 比 GPT-5.6 系列更容易接受,但仍不及专业宽松模型。如果 OpenAI 新版模型拒绝处理成人场景,4.1 是更愿意配合的选项,而宽松模型则更进一步。
What this page does not claim
- 这些评分仅描述 GPT-4.1 在小说场景中的散文表现,以 Novelmint 评测集为基准——并非 OpenAI 官方评级。
- 被 GPT-5.6 超越并不意味着它无法使用——它仍是一个可靠、熟悉的选项。
- GPT 是 OpenAI 的商标;本测评为独立评测,并非官方背书。