Modell-Tiefenanalyse · OpenAI

Wie GPT-4.1 Belletristik schreibt

GPT-4.1 ist das Modell der vorherigen OpenAI-Generation, und der Benchmark behandelt es entsprechend: kompetent, ausgewogen, ohne echte Schwäche oder echten Höhepunkt, und für Belletristik klar von seinen GPT-5.6-Nachfolgern übertroffen. Sein einziger Unterschied ist, dass es bereitwilliger als die 5.6-Familie mit reifen Inhalten umgeht. Für die meisten Belletristikprojekte sind die neueren Modelle die bessere Wahl, aber hier ist die ehrliche Einschätzung.

Measured profile

GPT-4.1

OpenAI

68

Overall craft

Craft — how well it writes

  • Literary71
  • Dialogue64
  • Fidelity70
  • Pacing68

Content — what it writes well

  • Emotion67
  • Physicality70
  • Conflict62
  • Romance70
  • Eroticism63

Scores are confidence-adjusted, 0–100. * marks a provisional axis (fewer than 6 samples). Measured on gpt-4.1-2025-04-14. See the full benchmark and methodology.

Key takeaways

Key takeaways

  • GPT-4.1 ist das Modell der vorherigen OpenAI-Generation – kompetent und ausgewogen, aber für Belletristik von der GPT-5.6-Familie übertroffen.
  • Es hat keine herausragende Stärke und keine gravierende Schwäche; es ordnet sich über alle Handwerksachsen hinweg im mittleren bis unteren Bereich ein.
  • Es ist bei expliziten Inhalten deutlich offener als GPT-5.6 Sol und Terra, die meist ablehnen.
  • Für die meisten Fiktionsprojekte ist GPT-5.6 (Sol oder Terra) die bessere OpenAI-Wahl beim Schreibhandwerk.
  • Seine verbliebene Nische ist die eines vertrauten, soliden Modells – auch dort, wo die Zurückhaltung der 5.6-Modelle bei expliziten Inhalten ein Problem darstellt.

How it writes

Kompetent – und überholt

GPT-4.1 macht nichts schlecht und nichts außergewöhnlich. Seine Handwerkswerte liegen in einem soliden mittleren bis unteren Bereich ohne klare Schwachstellen oder Spitzenwerte. Das war vor einer Generation eine starke Position; gegenüber den GPT-5.6-Modellen wirkt es jetzt wie die ältere Option – zuverlässig, aber in den für Fiktion wichtigen Bereichen übertroffen.

Offener bei expliziten Inhalten

Die einzige Achse, auf der es sich von seinen Nachfolgern unterscheidet, ist Bereitschaft: Es geht bereitwilliger mit reifen und expliziten Inhalten um als GPT-5.6 Sol und Terra, die weitgehend ablehnen. Das macht es nicht zu einem dedizierten permissiven Modell – ein echtes permissives Modell erzielt höhere Werte und lehnt weniger ab – aber es ist ein Vorteil, wenn die Zurückhaltung der neueren OpenAI-Modelle hinderlich ist.

Warum die neueren Modelle meist überlegen sind

Auf den Handwerks- und Inhaltsachsen, die gute Fiktion ausmachen – Dialog, Action, Konflikt, Treue zur Vorlage – liegt die GPT-5.6-Familie klar vorne. Solange du nicht speziell die höhere Bereitschaft von 4.1 bei expliziten Inhalten oder seine Vertrautheit benötigst, ist das Upgrade die naheliegende Wahl.

What the scores mean for a book

Empfohlen für

  • Eine vertraute, solide OpenAI-Option für allgemeines Schreiben.
  • Explizite Inhalte, die die GPT-5.6-Modelle ablehnen – hier hilft seine größere Bereitschaft.

Besser woanders aufgehoben

  • Erstklassiges OpenAI-Handwerk – GPT-5.6 Sol oder Terra übertreffen es durchweg.
  • Explizitestes Material, bei dem ein dediziertes permissives Modell führt.

In Novelmint

Wie Novelmint GPT-4.1 einsetzt

GPT-4.1 bleibt wählbar, doch der Router bevorzugt in der Regel die höher bewerteten GPT-5.6-Modelle, sofern diese verfügbar sind. 4.1 ist daher meist eine bewusste Wahl – wegen der Vertrautheit oder der Bereitschaft bei expliziten Inhalten, die den neueren Modellen fehlt. Füge es deinem Pool hinzu oder pinne es pro Beat; seine Bewertung stammt aus dem Live-Raster, das diese Seite anzeigt.

Questions

Frequently asked

Ist GPT-4.1 gut fürs Schreiben von Fiktion?
Es ist kompetent, aber überholt. Im Novelmint-Benchmark zeigt es ein ausgewogenes, mittleres bis schwaches Profil ohne herausragende Stärken, und die neueren GPT-5.6-Modelle liegen bei Fiktion klar vorne. Sein einziger Vorteil ist die größere Bereitschaft bei expliziten Inhalten.
GPT-4.1 oder GPT-5.6 für Fiktion?
GPT-5.6 (Sol oder Terra) für fast alles – sie übertreffen 4.1 auf den für Prosa entscheidenden Handwerks- und Inhaltsachsen. Die Ausnahme sind explizite Inhalte: 4.1 geht damit bereitwilliger um als die 5.6-Familie, die dazu neigt abzulehnen.
Kann GPT-4.1 explizite Szenen schreiben?
Bereitwilliger als die GPT-5.6-Modelle, aber immer noch unter einem dedizierten permissiven Modell. Wenn OpenAIs neuere Modelle eine explizite Szene ablehnen, ist 4.1 eine willigere Option – und ein permissives Modell ist noch williger.

What this page does not claim

  • Diese Werte beschreiben GPT-4.1s Prosa auf Fiktions-Beats, gemessen am beurteilten Novelmint-Datensatz – keine offizielle OpenAI-Bewertung.
  • Schlechter abzuschneiden als GPT-5.6 macht es nicht unbrauchbar – es bleibt eine solide, vertraute Option.
  • GPT ist eine Marke von OpenAI; dies ist eine unabhängige Messung, keine Empfehlung.

Solide – aber das Upgrade ist meist die richtige Wahl.

Vergleiche es mit GPT-5.6 in deinem eigenen Projekt. Dein erstes Kapitel ist kostenlos.