Key takeaways
- 模型按露骨成人内容的意愿与能力量化评分排列。
- 开放型 Grok 模型以大幅领先优势排名第一;Gemini 的参与度比大多数主流旗舰更为开放。
- GPT-5.6 及大多数 Claude 模型在此维度得分较低——这是意愿限制(会拒绝或写得临床化),而非技巧问题。
- 在 Novelmint 上,无论使用何种模型,露骨内容始终受你的书籍内容分级和平台规范约束。
The ranking
Ranked by Eroticism
按明确内容的意愿与能力从高到低排名。低分通常反映的是拒绝或描写生硬,而非写作能力不足。在 Novelmint 上,明确内容的生成受书籍内容评级限制,与所选模型无关。
- Grok 4.5xAI83
大幅领先。这是一款宽松型模型——在主流旗舰模型拒绝的场景中依然能正常输出,且能清晰处理肢体描写。可搭配更擅长对话的模型完成书中其余部分。
- Claude Opus 5Anthropic · Novelmint Lead78
- Grok 4.3xAI78
老款宽松型 Grok——意愿相当,写作能力略逊于 4.5。
- Gemini 3.1 ProGoogle77
比大多数主流旗舰模型更开放——是介于通用模型与专用宽松模型之间的有力选择。
- Gemini 3.5 FlashGoogle74
- Gemini 3.6 FlashGoogle73
- GPT-4.1OpenAI63
- Claude Opus 4.8Anthropic57
- Fable 5Anthropic54
- Claude Haiku 4.5Anthropic51
- Claude Sonnet 5Anthropic50
- GPT-5.6 TerraOpenAI35
- GPT-5.6 SolOpenAI32
在此项得分垫底——倾向拒绝或描写生硬。在动作、对话等方面表现出色,但不适合此类内容。
How this ranking is made
意愿排名,而非纯粹的写作能力
每个模型根据相同的场景提纲写作,由盲审评委小组在不知晓作者身份的情况下,从意愿和能力两个维度对明确内容进行评分。由于大多数模型会拒绝此类内容,这一维度更多是区分宽松型模型与主流模型,而非区分好文笔与差文笔。样本量较少时,分数会向中性基准收缩。Novelmint 上的明确内容输出受平台内容评级门控和硬性限制约束。
See the full nine-axis benchmark and methodologyQuestions
Frequently asked
- 哪款 AI 会写明确内容?
- 宽松型 Grok 模型大幅领先,能处理主流旗舰模型拒绝的明确内容;Gemini 比大多数模型更开放。GPT-5.6 及大多数 Claude 模型得分较低——是因为拒绝,而非能力不足。实时排名显示具体顺序。
- 为什么大多数 AI 模型拒绝写明确场景?
- 这是意愿限制,而非能力限制。有能力的模型在面对明确内容提纲时往往会生硬回避或直接拒绝。本基准直接对意愿进行评分,这也是该排名与整体写作能力排名差异显著的原因。
- Novelmint 允许明确内容吗?
- 明确内容受书籍内容评级及平台硬性限制管控,与所选模型无关。基准衡量模型能力;平台规定允许的内容范围。
What this page does not claim
- 此排名衡量的是平台在露骨内容上的意愿与能力,而非仅凭写作技巧,也不构成生成任何内容的许可——平台内容规则与硬性限制始终适用。
- 低分反映的是模型拒绝,而非能力不足。
- 模型名称均为各自所有者的商标,本测评为独立测量。