புனைகதை மாதிரி அளவுகோல்

எந்த AI மாதிரி உண்மையில் சிறந்த புனைகதை எழுதுகிறது?

Live data · measured as of July 24, 2026

ஒவ்வொரு மாதிரி அட்டையும் கணிதம், குறியீடு, மற்றும் தர்க்கத்தை அளவிடுகிறது. ஆனால் ஒரு மாதிரி வாசகர் தவிர்க்காத ஒரு காட்சியை எழுதக்கூடுமா என்று யாரும் அளவிடவில்லை. எனவே நாங்கள் அந்த அளவுகோலை உருவாக்கினோம். ஒரு குருட்டு நீதிபதி குழு முன்னணி மாதிரிகளிடம் இருந்து உருவாக்கப்பட்ட உண்மையான நாவல் உரைநடையை ஒன்பது அச்சுகளில் மதிப்பிடுகிறது — நான்கு திறனுக்கு, ஐந்து ஒரு புத்தகம் உண்மையில் கொண்டிருக்கும் காட்சி வகைகளுக்கு — கீழே உள்ள எண்கள் நேரடி முடிவு. இது ஒரு சந்தைப்படுத்தல் வரைபடம் அல்ல: இது Novelmint உங்கள் புத்தகத்தின் ஒவ்வொரு இடத்திற்கும் மாதிரியைத் தேர்வு செய்யப் படிக்கும் சரியான கட்டம்.

Key takeaways

  • இந்த அளவுகோல் Anthropic, OpenAI, Google, மற்றும் xAI-யின் முன்னணி மாதிரிகளை உண்மையான நாவல் உரைநடையில் — பல-தேர்வு சோதனைகளில் அல்ல — ஒன்பது அச்சுகளில் மதிப்பிடுகிறது: நான்கு திறன் (இலக்கிய, உரையாடல், நம்பகத்தன்மை, வேகம்) மற்றும் ஐந்து உள்ளடக்கம் (உணர்ச்சி, உடல்நிலை, மோதல், காதல், காமம்).
  • திறன் அச்சுகள் ஒரு மாதிரி எவ்வளவு நன்றாக எழுதுகிறது என்பதை அளவிடுகின்றன; உள்ளடக்க அச்சுகள் அது எந்த வகை காட்சியை நன்றாக எழுதுகிறது என்பதை அளவிடுகின்றன. ஒரு மாதிரி அழகான வாக்கியங்கள் எழுதலாம், ஆனால் சண்டைக் காட்சிகளை வெறுமையாக எழுதலாம் — எனவே இரண்டும் தனித்தனியாக வைக்கப்படுகின்றன, ஒரு தவறான எண்ணாக சராசரி கணக்கிடப்படுவதில்லை.
  • ஒவ்வொரு மதிப்பெண்ணும் அதன் பின்னால் உள்ள தரவு எவ்வளவு குறைவானது என்பதற்கு ஏற்ப நடுநிலை 70 அடிப்படையை நோக்கி நம்பிக்கையுடன் சுருக்கப்படுகிறது — எனவே மூன்று மாதிரிகளின் அதிர்ஷ்டமான முடிவு ஒரு நிலையான உண்மை போல் மாறுவேஷம் போட முடியாது. ஒவ்வொரு எண்ணின் பின்னால் உள்ள மாதிரி எண்ணிக்கை காட்டப்படுகிறது.
  • எந்த ஒரு மாதிரியும் அனைத்தையும் வெல்வதில்லை. மிகவும் வலிமையான ஒட்டுமொத்த இலக்கிய திறன், மிகவும் நிலையான நம்பகத்தன்மை, சிறந்த செயல், மற்றும் மிகவும் தயாரான காதல் மற்றும் வெளிப்படையான எழுத்து வெவ்வேறு நெடுவரிசைகளில் உள்ளன — ஒரே ஒரு மாதிரியை தேர்ந்தெடுப்பதை விட ஒரு புத்தகத்தை மாதிரிகள் முழுவதும் திசைதிருப்புவதற்கான முழு வாதம் இதுவே.
  • இது Novelmint ஒரு அத்தியாயத்தை கட்டும் போது ஒவ்வொரு இடத்திற்கும் மாதிரியை தேர்வு செய்யப் பயன்படுத்தும் அதே கட்டம் — மற்றும் ஒரு கட்டுமானத்தின் போது ஒரு பகுதியை மதிப்பிடும் அதே நீதிபதி அதை ஊட்டுகிறார், எனவே ஆசிரியர்கள் என்ஜினுடன் எழுதும்போது எண்கள் தொடர்ந்து புதுப்பிக்கப்படுகின்றன. இது ஒரு நேரடி வழிமுறை, பின்னோக்கி பார்க்கும் கூற்று அல்ல.

The benchmark

Frontier models on real novel prose

Live data · updated July 24, 2026

இது நேரடி தரவு, ஒரு முறை சோதனை அல்ல

கீழே உள்ள அட்டவணை நாங்கள் ஒருமுறை இயக்கி உறைய வைத்த அளவுகோல் அல்ல. இது தளம் இயங்கும் மதிப்பெண் களஞ்சியத்தின் நேரடி திட்டம்: ஒரு கட்டுமானத்தின் போது ஒரு பகுதியை மதிப்பிடும் அதே நீதிபதி இந்த கட்டத்தை ஊட்டுகிறார் — எனவே Novelmint-ல் எழுதப்படும் ஒவ்வொரு அத்தியாயமும் கவனிப்புகளை சேர்க்கிறது, மாதிரி எண்ணிக்கைகள் வளர்கின்றன, மற்றும் எண்கள் கூர்மையாகின்றன. அதிக ஆசிரியர்கள் என்ஜினுடன் கட்டுகையில், அளவுகோல் தொடர்ந்து புதுப்பிக்கப்படுகிறது — மேலே உள்ள தேதி வெறும் மிகவும் சமீபத்திய மறு அளவீட்டை குறிக்கிறது.

Novelmint fiction-model benchmark — measured craft and content-fitness scores (0–100) for frontier AI models on real novel prose. Click a column heading to sort.
Craft — how well it writesContent — what it writes well
Claude Opus 5LeadAnthropic85848786838784848278
Claude Opus 4.8Anthropic82877287848677798157
Fable 5Anthropic75797973708273738454
GPT-5.6 SolOpenAI84878483848593898332
Claude Sonnet 5Anthropic74697679728278757550
Claude Haiku 4.5Anthropic65726064637163686851
GPT-5.6 TerraOpenAI80798280798186848135
GPT-4.1OpenAI68716470686770627063
Gemini 3.1 ProGoogle73657277807481777677
Gemini 3.5 FlashGoogle78767680796871807374
Gemini 3.6 FlashGoogle74717378747480717273
Grok 4.5xAI67665275766479737383
Grok 4.3xAI65676174607378717378
0–100 confidence-adjusted score* = fewer than 6 samples (provisional)Click a column heading to sort · hover a cell for its sample size

கட்டத்தை எவ்வாறு படிப்பது

தலைப்பு எண் ஒட்டுமொத்த திறன் — ஒரு மாதிரியின் நான்கு செயல்திறன் அச்சுகளின் சராசரி, இது "அதன் உரைநடை எவ்வளவு நல்லது" என்பதற்கு மிகவும் நெருக்கமான விஷயம். வலதுபுறத்தில் உள்ள உள்ளடக்க அச்சுகள் சிறந்தது-அல்லது-மோசமான தரவரிசைகள் அல்ல; அவை மாதிரி என்ன பொருத்தமானது என்று சொல்கின்றன. அதிக உடல்நிலை மதிப்பெண் சுத்தமான செயலை குறிக்கிறது; குறைந்த காம மதிப்பெண் பொதுவாக பலவீனமான எழுத்தை விட மறுப்பு அல்லது மருத்துவ தட்டையைக் குறிக்கிறது — திறமை அல்ல, தயார்நிலை. மாதிரிகளை ஒப்பிட நெடுவரிசையில் திறனை படிக்கவும், ஒரு மாதிரி எங்கு வலிமையானது எங்கு இல்லை என்று பார்க்க வரிசையில் உள்ளடக்கத்தை படிக்கவும்.

Not sure which to use?

Tell us what your book leans on

Pick what matters most for your story. We’ll rank the models for exactly that — the same way the build router chooses.

Choose one or more above to see your best-fit models.

Methodology

How the numbers are produced

01

சோதனை பதில்களை அல்ல, உண்மையான உரைநடையை உருவாக்குங்கள்

ஒவ்வொரு மாதிரியும் ஒரே இடங்களை எழுதுகிறது — தேவையான கூறுகள், தடைசெய்யப்பட்ட அறிவு, ஒரு பார்வைக் கோணம், மற்றும் ஒரு நாடகத்திற்கான இலக்கு கொண்ட காட்சிகள் — ஒரே நிலைமைகளில். ஒரு ஆசிரியர் படிக்கும் விதத்தில், ஒரு வினாடி வினா போல் செயல்படுகிறதா என்று அல்ல, அது புனைகதையாக என்ன உருவாக்குகிறது என்று நாங்கள் மதிப்பிடுகிறோம்.

02

குருட்டாக, ஒன்பது அச்சுகளில் மதிப்பிடுங்கள்

ஒரு நீதிபதி குழு ஒவ்வொரு பகுதியையும் நான்கு திறன் அச்சுகளில் (இலக்கிய, உரையாடல், நம்பகத்தன்மை, வேகம்) மற்றும் ஐந்து உள்ளடக்க அச்சுகளில் (உணர்ச்சி, உடல்நிலை, மோதல், காதல், காமம்) 0–100 மதிப்பிடுகிறது — எந்த மாதிரி எழுதியது என்று தெரியாமல். திறன் என்பது செயல்திறன் தரம்; உள்ளடக்கம் என்பது ஒரு வகை காட்சிக்கான பொருத்தம்.

03

நடுநிலை முன்னோடியை நோக்கி சுருக்குங்கள்

சில மாதிரிகளிலிருந்து கணக்கிடப்பட்ட ஒரு மூல சராசரி சத்தம். ஒவ்வொரு கலமும் அதன் ஆதாரம் எவ்வளவு மெல்லியது என்பதற்கு ஏற்ப நடுநிலை 70 அடிப்படையை நோக்கி இழுக்கப்படுகிறது — எனவே ஒரு ஆரம்ப, அதிர்ஷ்டமான அளவீடு போதுமான கவனிப்புகள் ஒரு இடத்தை சம்பாதிக்கும் வரை தோராயமாக சராசரியாக படிக்கப்படும். வெளியிடப்பட்ட எண் இந்த சுருக்கப்பட்ட மதிப்பு; மாதிரி எண்ணிக்கை அதன் பக்கத்தில் காட்டப்படுகிறது.

04

மடிக்கத் தொடருங்கள், கையால் மேலெழுத வேண்டாம்

புதிய நீதிபதி கவனிப்புகள் ஒரு இயங்கும் சராசரியில் மடிக்கப்படுகின்றன மற்றும் மாதிரி எண்ணிக்கை வளர்கிறது — எனவே கட்டம் காலப்போக்கில் கூர்மையாகிறது. எண்கள் கவனிப்புகளிலிருந்து மீண்டும் உருவாக்கப்படுகின்றன, கையால் தட்டச்சு செய்யப்படுவதில்லை — ஒரு மாதிரி பதிப்பு ஒரு மாற்றுப் பெயரின் கீழ் மாறும் போது அதன் கலங்கள் இரண்டு வெவ்வேறு மாதிரிகளை கலப்பதற்கு பதிலாக சுத்தமான மறு அளவீட்டிற்கு மீட்டமைக்கப்படுகின்றன.

Where this leads

இப்படிப்பட்ட அளவுகோல் ஏன் பயன்படுத்தக்கூடியது

ஒரு காட்சிக்கு வேறு மாதிரியை தேர்வு செய்வது ஒரு புத்தகம் ஒரே பாஸில் உருவாக்கப்படுவதற்கு பதிலாக தனித்தனி, விவரிக்கப்பட்ட அலகுகளில் கட்டப்பட்டால் மட்டுமே செயல்படும். அந்த அலகு இடம், மற்றும் வெவ்வேறு மாதிரிகள் வெவ்வேறு இடங்களை எழுதும்போது கதையை ஒத்திசைவாக வைத்திருப்பது கட்டுமானத்துடன் பயணிக்கும் ஒரு வில்-மற்றும்-நிறுவன நினைவின் வேலை. அளவுகோல் மதிப்பெண் பலகை; இடங்களும் வில் நினைவும் ஒரு புத்தகம் உண்மையில் அதை செலவிட அனுமதிப்பவை.

Questions

Frequently asked

எந்த AI மாதிரி சிறந்த புனைகதை எழுதுகிறது?
ஒட்டுமொத்த திறன் — உண்மையான நாவல் உரைநடையில் இலக்கிய, உரையாடல், நம்பகத்தன்மை மற்றும் வேகம் அச்சுகளின் சராசரி — மூலம், Claude Opus 4.8 தற்போது முன்னணியில் உள்ளது, GPT-5.6 Sol அதற்கு நெருக்கத்தில் உள்ளது. ஆனால் "சிறந்தது" காட்சியைப் பொறுத்தது: செயல், காதல் மற்றும் வெளிப்படையான உள்ளடக்கத்திற்கான அதிக மதிப்பெண்கள் வெவ்வேறு மாதிரிகளில் உள்ளன. இந்தப் பக்கத்திலுள்ள கட்டம் தற்போதைய நிலை மற்றும் ஒவ்வொரு எண்ணின் பின்னால் உள்ள மாதிரி எண்ணிக்கையைக் காட்டுகிறது.
இந்த அளவுகோல் எவ்வாறு அளவிடப்படுகிறது?
ஒவ்வொரு மாதிரியும் ஒரே நிலைமைகளில் ஒரே விவரிக்கப்பட்ட இடங்களை எழுதுகிறது, மற்றும் ஒரு குருட்டு நீதிபதி குழு உருவாக்கப்பட்ட உரைநடையை ஒன்பது அச்சுகளில் 0–100 மதிப்பிடுகிறது — நான்கு திறனுக்கு (இலக்கிய, உரையாடல், நம்பகத்தன்மை, வேகம்) மற்றும் ஐந்து உள்ளடக்க வகைக்கு (உணர்ச்சி, உடல்நிலை, மோதல், காதல், காமம்). மதிப்பெண்கள் மெல்லிய தரவு ஒரு எண்ணை அசைக்க முடியாதபடி நடுநிலை 70 அடிப்படையை நோக்கி நம்பிக்கையுடன் சுருக்கப்படுகின்றன, மற்றும் மாதிரி எண்ணிக்கை ஒவ்வொரு மதிப்பெண்ணின் பக்கத்திலும் காட்டப்படுகிறது.
திறன் அச்சுகளுக்கும் உள்ளடக்க அச்சுகளுக்கும் என்ன வித்தியாசம்?
திறன் அச்சுகள் ஒரு மாதிரி எவ்வளவு நன்றாக எழுதுகிறது என்பதை அளவிடுகின்றன, விஷயத்தைப் பொருட்படுத்தாமல் — வாக்கிய தரம், பாத்திர குரல், சுருக்கத்திற்கான நம்பகத்தன்மை, மற்றும் வேகக் கட்டுப்பாடு. உள்ளடக்க அச்சுகள் ஒரு வகை காட்சிக்கான பொருத்தத்தை அளவிடுகின்றன: உணர்ச்சி, உடல் செயல், மோதல், காதல், மற்றும் வெளிப்படையான உள்ளடக்கம். ஒரு மாதிரி அழகான வாக்கியங்கள் எழுதலாம், ஆனால் சண்டைக் காட்சியை மோசமாக கையாளலாம் — எனவே இரண்டு குடும்பங்களும் தனித்தனியாக மதிப்பிடப்பட்டு காட்டப்படுகின்றன.
ஏன் ஒரே ஒரு சிறந்த மாதிரியை தேர்வு செய்து எல்லாவற்றிற்கும் பயன்படுத்தக்கூடாது?
ஏனென்றால் எந்த மாதிரியும் ஒவ்வொரு அச்சிலும் வெல்வதில்லை. மிகவும் வலிமையான இலக்கிய திறன், சிறந்த செயல், மற்றும் மிகவும் திறமையான காதல் அல்லது வெளிப்படையான எழுத்து வெவ்வேறு மாதிரிகளைச் சேர்ந்தது. Novelmint ஒரு புத்தகத்தை மாதிரிகள் முழுவதும் இடம் தோறும் திசைதிருப்புகிறது — பெரும்பகுதியை ஒத்திசைவுக்காக ஒரு தொடர் குரலில் வைத்து, அதை சம்பாதிக்கும் குறிப்பிட்ட இடங்களில் மட்டும் வலிமையான மாதிரியிடம் விலகுகிறது — இது இந்த கட்டம் இருப்பதால் மட்டுமே சாத்தியம்.
குறைந்த மதிப்பெண் என்பது ஒரு மாதிரி மோசமானது என்று பொருளா?
அவசியமில்லை. குறைந்த உள்ளடக்க மதிப்பெண் மாதிரி திறமையானது ஆனால் தயாரில்லாமல் இருக்கிறது என்று பொருளாகலாம் — பெரும்பாலான மாதிரிகள் காமத்தில் குறைந்த மதிப்பெண் பெறுகின்றன, ஏனென்றால் அவை மறுக்கின்றன அல்லது மருத்துவமாகி விடுகின்றன, திறமை குறைவால் அல்ல. மற்றும் குறைந்த நம்பிக்கை மதிப்பெண் (சில மாதிரிகள்) நடுநிலை அடிப்படையை நோக்கி சுருக்கப்படுகிறது — எனவே அது "இன்னும் நிரூபிக்கப்படவில்லை" என்று படிக்கப்படுகிறது, "பலவீனமாக நிரூபிக்கப்பட்டது" அல்ல. மதிப்பெண்ணை எப்போதும் அதன் மாதிரி எண்ணிக்கையுடன் படிக்கவும்.
அளவுகோல் எவ்வளவு அடிக்கடி புதுப்பிக்கப்படுகிறது?
தொடர்ச்சியாக. கட்டம் தளத்தின் மதிப்பெண் களஞ்சியத்தின் நேரடி திட்டம்: Novelmint ஒரு அத்தியாயத்தை கட்டும்போது ஒரு பகுதியை மதிப்பிடும் அதே நீதிபதி அதன் கவனிப்புகளை மீண்டும் மடிக்கிறார் — எனவே ஆசிரியர்கள் என்ஜினைப் பயன்படுத்தும்போது எண்கள் நகர்கின்றன மற்றும் மாதிரி எண்ணிக்கைகள் வளர்கின்றன. பக்கம் மிகவும் சமீபத்திய மறு அளவீட்டின் தேதியைக் காட்டுகிறது. புதிய மாதிரி பதிப்புகள் அவை மாற்றிய மாதிரியுடன் கலக்கப்படுவதற்கு பதிலாக புதிதாக மீண்டும் அளவிடப்படுகின்றன — எனவே ஒரு பதிப்பு மாற்றம் ஒரு நெடுவரிசையை அமைதியாக சீர்கெட்டதாக மாற்றாது.

What this page does not claim

  • இந்த அளவுகோல் புனைகதைக்கான உரைநடை தரம் மற்றும் உள்ளடக்க பொருத்தத்தை மட்டுமே அளவிடுகிறது. மாதிரியின் தர்க்கம், குறியீடு, கணிதம், உண்மை துல்லியம், அல்லது எழுத்துச் சூழலுக்கு வெளியே பாதுகாப்பு பற்றி எதுவும் சொல்வதில்லை.
  • மதிப்பெண்கள் நீதிபதியிடப்பட்ட தொகுப்பு மற்றும் பயன்படுத்தப்பட்ட உடனடி செய்திகளுக்கு தொடர்புடையவை — மாதிரி வழங்குநர்களால் அங்கீகரிக்கப்பட்ட முழுமையான அல்லது அதிகாரப்பூர்வ மதிப்பீடு அல்ல. மாதிரி பெயர்கள் மற்றும் வர்த்தக முத்திரைகள் அவற்றின் உரிமையாளர்களுக்கு சொந்தமானவை.
  • அதிக ஒட்டுமொத்த திறன் மதிப்பெண் என்பது ஒரு மாதிரி ஒவ்வொரு புத்தகத்திற்கும் சரியான தேர்வு என்று பொருளல்ல — குரல், வகை, உள்ளடக்க தேவைகள், மற்றும் செலவு ஆகியவை முக்கியம் — இதனால்தான் Novelmint ஒரே ஒன்றை முடிசூட்டுவதற்கு பதிலாக மாதிரிகள் முழுவதும் திசைதிருப்புகிறது.
  • குறைந்த மாதிரி கலங்கள் தற்காலிகமானவை. ஒரு எண் சில கவனிப்புகளை கொண்டிருக்கும் இடத்தில் அது நடுநிலை அடிப்படையை நோக்கி சுருக்கப்பட்டு கொடியிடப்படுகிறது, மேலும் கவனிப்புகள் மடிக்கப்படும்போது அது நகரும்.

தொடர்புடையவை

செயல்பாட்டுக் காட்சிகளுக்கு சிறந்த AI

எந்த AI ஒரு சண்டை அல்லது துரத்தலை தெளிவாகவும் உறுதியாகவும் வைத்திருக்கிறது. உடல் இயக்கத்தில் தரவரிசை.

மோதல் காட்சிகளுக்கு சிறந்த AI

எந்த AI ஒரு வாக்குவாதம் அல்லது எதிர்நிலையை இறுகவும் உயர்வாகவும் வைத்திருக்கிறது. அளவிடப்பட்ட மோதலில் தரவரிசை.

உணர்ச்சிக் காட்சிகளுக்கு சிறந்த AI

எந்த AI ஒரு உணர்வு-சார்ந்த காட்சியை வெறும் விவரிப்பாக இல்லாமல் உயிரோட்டமாக்குகிறது. உணர்ச்சியில் தரவரிசை.

வெளிப்படையான காட்சிகளுக்கான சிறந்த AI

எந்த AI உண்மையில் வெளிப்படையான பெரியவர் உள்ளடக்கத்தை எழுதும் — எவை மறுக்கும். விருப்பத்தில் தரவரிசைப்படுத்தப்பட்டது.

எந்த மாதிரியை பயன்படுத்த வேண்டும் என்று யூகிப்பதை நிறுத்துங்கள். புத்தகம் தேர்வு செய்யட்டும்.

Novelmint ஒவ்வொரு இடத்தையும் இந்த கட்டம் மிகவும் பொருத்தமானது என்று சொல்லும் மாதிரிக்கு திசைதிருப்புகிறது. உங்கள் முதல் அத்தியாயம் இலவசம்.