Grok 4.5 的小说写作方式
Grok 4.5 是测评集中的专才模型。它在露骨内容上大幅领先,肢体动作描写清晰有力,且与大多数模型不同——它不会拒绝。当场景需要直接表达时,它能胜任。代价在于其他方面:它的对话是所有测评模型中最弱的,文学性和情感深度也低于平均水平。请将它用在它最擅长的地方,其余场景交给其他模型。
Measured profile
Grok 4.5
xAI
67
Overall craft
Craft — how well it writes
- Literary66
- Dialogue52
- Fidelity75
- Pacing76
Content — what it writes well
- Emotion64
- Physicality79
- Conflict73
- Romance73
- Eroticism83
Scores are confidence-adjusted, 0–100. * marks a provisional axis (fewer than 6 samples). Measured on grok-4.5. See the full benchmark and methodology.
Key takeaways
Key takeaways
- Grok 4.5 在露骨内容方面大幅领先基准测试,且作为宽松模型,它在 GPT 和 Claude 旗舰拒绝时仍会参与创作。
- 它能清晰处理肢体动作场景,并在大样本测试中保持对创作简报的忠实度。
- 其最明显的弱点是对话——在测评中所有模型里得分最低——文学性和情感写作也低于平均水平。
- 这使它成为专才:擅长成人场景和写实动作,而非通用的主导写作声音。
- 最适合搭配在文学性或对话方面更强的模型,由后者承担书中其余部分的创作。
How it writes
敢于触碰他人不愿涉足之处
Grok 4.5 的核心优势在于"意愿度"。它在露骨内容方面大幅领先基准测试,作为宽松模型,它能处理 GPT-5.6 系列和 Claude 旗舰拒绝或以临床笔调呈现的成人内容。对于包含真实露骨场景的书籍,它是测评中最有能力、也最愿意配合的选择。
运动中的身体,清晰呈现
它的另一真实优势在于肢体感——动作、运动、压力下的身体——描写清晰而非模糊,并能在大样本测试中可靠地遵循创作简报。写实的肢体场景是它在非露骨写作中最强的领域。
对话是其短板
与之对应的弱点同样鲜明:Grok 4.5 的对话评分在基准测试中垫底。其对话倾向于平淡、功能性,而非富有人物个性,因此对话密集的场景最需要其他模型的补充。其文学气质和情感深度也低于平均水平——这不是适合写内心独白或柔情转折的模型。
专才,而非主导
合理使用 Grok 4.5 的方式是有所取舍:让它处理最擅长的成人场景和写实动作,由更强的模型承担对话、情感和整本书的基调。作为专才,它确实有用;作为通用主导声音,它会将文风拉向其弱势维度。
What the scores mean for a book
适合用于
- 露骨与成人场景——其明显的大幅领先优势,且不会拒绝。
- 写实的肢体动作与场景机制。
- 直接表达比文学打磨更重要的场景。
建议改用其他模型
- 对话密集的场景——这是它最弱的维度,差距明显。
- 文学性、内心独白主导或情感强烈的段落。
- 整本书的基调——将它作为专才使用,而非主导。
In Novelmint
Novelmint 如何使用 Grok 4.5
Grok 4.5 是路由器在章节需要宽松处理时——例如旗舰模型会拒绝的露骨场景——或需要清晰肢体动作描写时所倚重的模型,而文学性或对话更强的模型则负责周边散文。成人内容无论选择何种模型,均受你书目内容评级的约束。你可以将其加入模型池,或按章节固定使用;其排名来自本页实时渲染的评测网格。
Questions
Frequently asked
- Grok 擅长写小说吗?
- 作为专才,是的。Grok 4.5 在 Novelmint 基准测试中的露骨内容方面大幅领先,肢体动作描写清晰,且在其他模型拒绝时仍能配合。但它的对话是测评中最弱的,文学性和情感深度也不足,因此最适合专项使用,而非作为全书的主导声音。
- Grok 在长篇小说中最擅长什么?
- 成人与露骨场景,以及写实的肢体动作。它是测评中在露骨内容方面最愿意配合、也最有能力的模型,动作描写清晰有力。它不适合对话、抒情散文或情感深度的创作。
- 当其他模型拒绝时,Grok 能写露骨内容吗?
- 可以——它是宽松模型,在基准测试的露骨内容方面得分最高,能处理 GPT-5.6 和 Claude 旗舰拒绝的内容。在 Novelmint 上,此类内容仍受你书目内容评级和平台规则的约束。
What this page does not claim
- 这些评分仅描述 Grok 4.5 在小说场景中的散文表现,以 Novelmint 评测集为基准——并非 xAI 官方评级。
- 露骨内容高分衡量的是该维度的意愿度与能力,并非对任何特定内容的背书;平台内容规则仍然适用。
- Grok 是 xAI 的商标;本测评为独立评测,并非官方背书。