模型深度评测 · xAI

Grok 4.5 的小说写作方式

Grok 4.5 是测评集中的专才模型。它在露骨内容上大幅领先,肢体动作描写清晰有力,且与大多数模型不同——它不会拒绝。当场景需要直接表达时,它能胜任。代价在于其他方面:它的对话是所有测评模型中最弱的,文学性和情感深度也低于平均水平。请将它用在它最擅长的地方,其余场景交给其他模型。

Measured profile

Grok 4.5

xAI

67

Overall craft

Craft — how well it writes

  • Literary66
  • Dialogue52
  • Fidelity75
  • Pacing76

Content — what it writes well

  • Emotion64
  • Physicality79
  • Conflict73
  • Romance73
  • Eroticism83

Scores are confidence-adjusted, 0–100. * marks a provisional axis (fewer than 6 samples). Measured on grok-4.5. See the full benchmark and methodology.

Key takeaways

Key takeaways

  • Grok 4.5 在露骨内容方面大幅领先基准测试,且作为宽松模型,它在 GPT 和 Claude 旗舰拒绝时仍会参与创作。
  • 它能清晰处理肢体动作场景,并在大样本测试中保持对创作简报的忠实度。
  • 其最明显的弱点是对话——在测评中所有模型里得分最低——文学性和情感写作也低于平均水平。
  • 这使它成为专才:擅长成人场景和写实动作,而非通用的主导写作声音。
  • 最适合搭配在文学性或对话方面更强的模型,由后者承担书中其余部分的创作。

How it writes

敢于触碰他人不愿涉足之处

Grok 4.5 的核心优势在于"意愿度"。它在露骨内容方面大幅领先基准测试,作为宽松模型,它能处理 GPT-5.6 系列和 Claude 旗舰拒绝或以临床笔调呈现的成人内容。对于包含真实露骨场景的书籍,它是测评中最有能力、也最愿意配合的选择。

运动中的身体,清晰呈现

它的另一真实优势在于肢体感——动作、运动、压力下的身体——描写清晰而非模糊,并能在大样本测试中可靠地遵循创作简报。写实的肢体场景是它在非露骨写作中最强的领域。

对话是其短板

与之对应的弱点同样鲜明:Grok 4.5 的对话评分在基准测试中垫底。其对话倾向于平淡、功能性,而非富有人物个性,因此对话密集的场景最需要其他模型的补充。其文学气质和情感深度也低于平均水平——这不是适合写内心独白或柔情转折的模型。

专才,而非主导

合理使用 Grok 4.5 的方式是有所取舍:让它处理最擅长的成人场景和写实动作,由更强的模型承担对话、情感和整本书的基调。作为专才,它确实有用;作为通用主导声音,它会将文风拉向其弱势维度。

What the scores mean for a book

适合用于

  • 露骨与成人场景——其明显的大幅领先优势,且不会拒绝。
  • 写实的肢体动作与场景机制。
  • 直接表达比文学打磨更重要的场景。

建议改用其他模型

  • 对话密集的场景——这是它最弱的维度,差距明显。
  • 文学性、内心独白主导或情感强烈的段落。
  • 整本书的基调——将它作为专才使用,而非主导。

In Novelmint

Novelmint 如何使用 Grok 4.5

Grok 4.5 是路由器在章节需要宽松处理时——例如旗舰模型会拒绝的露骨场景——或需要清晰肢体动作描写时所倚重的模型,而文学性或对话更强的模型则负责周边散文。成人内容无论选择何种模型,均受你书目内容评级的约束。你可以将其加入模型池,或按章节固定使用;其排名来自本页实时渲染的评测网格。

Questions

Frequently asked

Grok 擅长写小说吗?
作为专才,是的。Grok 4.5 在 Novelmint 基准测试中的露骨内容方面大幅领先,肢体动作描写清晰,且在其他模型拒绝时仍能配合。但它的对话是测评中最弱的,文学性和情感深度也不足,因此最适合专项使用,而非作为全书的主导声音。
Grok 在长篇小说中最擅长什么?
成人与露骨场景,以及写实的肢体动作。它是测评中在露骨内容方面最愿意配合、也最有能力的模型,动作描写清晰有力。它不适合对话、抒情散文或情感深度的创作。
当其他模型拒绝时,Grok 能写露骨内容吗?
可以——它是宽松模型,在基准测试的露骨内容方面得分最高,能处理 GPT-5.6 和 Claude 旗舰拒绝的内容。在 Novelmint 上,此类内容仍受你书目内容评级和平台规则的约束。

What this page does not claim

  • 这些评分仅描述 Grok 4.5 在小说场景中的散文表现,以 Novelmint 评测集为基准——并非 xAI 官方评级。
  • 露骨内容高分衡量的是该维度的意愿度与能力,并非对任何特定内容的背书;平台内容规则仍然适用。
  • Grok 是 xAI 的商标;本测评为独立评测,并非官方背书。

专为其他模型不愿触碰的场景而生。

让 Grok 负责它最擅长的场景,由更强的模型塑造整体声音。第一章免费。