Лучший ИИ по · Точности

Лучший ИИ для следования инструкциям

Live data · ranked by Fidelity · measured as of August 31, 2026

Если вы пишете по плану, самое ценное, что модель может сделать, — это именно то, о чём вы попросили: сохранить нужные элементы, не добавить скрытые знания и не уйти в придуманную предысторию. Этот рейтинг оценивает модели по такой точности, которая в длинной прозе незаметно значит больше, чем яркость: модель, отклоняющаяся на каждой сцене, создаёт рукопись, которую придётся постоянно сверять заново.

Key takeaways

  • Модели ранжируются по измеренной точности — насколько точно они воспроизводят заданную сцену — на реальной романной прозе.
  • Claude Opus 4.8 уверенно лидирует по точности — именно это делает её основным голосом книги.
  • Высокая точность накапливается по всему роману: она позволяет задуманной структуре держаться, а не отклоняться понемногу на каждой сцене.
  • Рейтинг актуален и обновляется по мере накопления измерений прозы.

The ranking

Ranked by Fidelity

Ранжирование от высшего к низшему по измеренной точности. Оценка — скорректированное по уверенности значение каждой модели по оси точности, от 0 до 100.

  1. 91

    Лидирует по точности с большим отрывом. Выполняет заданную сцену почти без отклонений — самое ценное качество для надёжного основного голоса.

  2. Claude Opus 5Anthropic · Novelmint Lead
    89
  3. 83

    Надёжно и точно выполняет задание, плюс лидирует в экшне и конфликте.

  4. 80
  5. Лучший подтверждённый показатель — точность, что делает эту быструю и дешёвую модель надёжной рабочей лошадкой для создания больших объёмов черновиков.

  6. 79
  7. 75
  8. 74
  9. Fable 5Anthropic
    73

    Сторителлинг-модель держится за задание свободнее — нередко именно это придаёт ей жизнь на странице, но в критически важных для непрерывности сценах иногда требует более чёткого промпта.

  10. GPT-4.1OpenAI
    70
  11. 64

How this ranking is made

Оценка точности выполнения задания

Каждая модель пишет одни и те же заданные биты — с обязательными элементами, скрытым знанием, точкой зрения — и слепая коллегия судей оценивает, насколько точно проза выполняет это задание, не зная автора. Небольшие выборки сжимаются к нейтральной базовой линии. На этой странице модели упорядочены по этой единственной оси.

See the full nine-axis benchmark and methodology

Questions

Frequently asked

Какой ИИ наиболее точно следует авторскому заданию?
Claude Opus 4.8 уверенно лидирует по измеренной точности в бенчмарке Novelmint — воспроизводит заданную сцену с минимальными отклонениями и домысливанием. Актуальный рейтинг отражает полный порядок.
Почему точность важна для романа?
Модель, отклоняющаяся понемногу на каждой сцене, создаёт рукопись, которую приходится постоянно сверять заново. Высокая точность позволяет задуманной структуре держаться — правки остаются в силе, а непрерывность сохраняется.
Значит ли высокая точность меньшую творческую свободу?
Не обязательно — точность измеряет верность заданию, а не банальность. Opus лидирует одновременно по точности и литературному мастерству. Более свободная модель вроде Fable может ощущаться раскованнее — иногда это плюс, иногда лишнее отклонение.

What this page does not claim

  • Рейтинг основан исключительно на измеренной точности в художественных сценах.
  • Верность заданию — одна из девяти осей; проверьте остальные, нужные вашей книге.
  • Названия моделей являются товарными знаками соответствующих владельцев; это независимое измерение.

Пишите по плану, которому модель действительно следует.

Novelmint работает по структурированному поэпизодному плану. Первая глава — бесплатно.