எந்த AI மாதிரி உண்மையில் சிறந்த புனைகதை எழுதுகிறது?
Live data · measured as of July 24, 2026
ஒவ்வொரு மாதிரி அட்டையும் கணிதம், குறியீடு, மற்றும் தர்க்கத்தை அளவிடுகிறது. ஆனால் ஒரு மாதிரி வாசகர் தவிர்க்காத ஒரு காட்சியை எழுதக்கூடுமா என்று யாரும் அளவிடவில்லை. எனவே நாங்கள் அந்த அளவுகோலை உருவாக்கினோம். ஒரு குருட்டு நீதிபதி குழு முன்னணி மாதிரிகளிடம் இருந்து உருவாக்கப்பட்ட உண்மையான நாவல் உரைநடையை ஒன்பது அச்சுகளில் மதிப்பிடுகிறது — நான்கு திறனுக்கு, ஐந்து ஒரு புத்தகம் உண்மையில் கொண்டிருக்கும் காட்சி வகைகளுக்கு — கீழே உள்ள எண்கள் நேரடி முடிவு. இது ஒரு சந்தைப்படுத்தல் வரைபடம் அல்ல: இது Novelmint உங்கள் புத்தகத்தின் ஒவ்வொரு இடத்திற்கும் மாதிரியைத் தேர்வு செய்யப் படிக்கும் சரியான கட்டம்.
Key takeaways
- இந்த அளவுகோல் Anthropic, OpenAI, Google, மற்றும் xAI-யின் முன்னணி மாதிரிகளை உண்மையான நாவல் உரைநடையில் — பல-தேர்வு சோதனைகளில் அல்ல — ஒன்பது அச்சுகளில் மதிப்பிடுகிறது: நான்கு திறன் (இலக்கிய, உரையாடல், நம்பகத்தன்மை, வேகம்) மற்றும் ஐந்து உள்ளடக்கம் (உணர்ச்சி, உடல்நிலை, மோதல், காதல், காமம்).
- திறன் அச்சுகள் ஒரு மாதிரி எவ்வளவு நன்றாக எழுதுகிறது என்பதை அளவிடுகின்றன; உள்ளடக்க அச்சுகள் அது எந்த வகை காட்சியை நன்றாக எழுதுகிறது என்பதை அளவிடுகின்றன. ஒரு மாதிரி அழகான வாக்கியங்கள் எழுதலாம், ஆனால் சண்டைக் காட்சிகளை வெறுமையாக எழுதலாம் — எனவே இரண்டும் தனித்தனியாக வைக்கப்படுகின்றன, ஒரு தவறான எண்ணாக சராசரி கணக்கிடப்படுவதில்லை.
- ஒவ்வொரு மதிப்பெண்ணும் அதன் பின்னால் உள்ள தரவு எவ்வளவு குறைவானது என்பதற்கு ஏற்ப நடுநிலை 70 அடிப்படையை நோக்கி நம்பிக்கையுடன் சுருக்கப்படுகிறது — எனவே மூன்று மாதிரிகளின் அதிர்ஷ்டமான முடிவு ஒரு நிலையான உண்மை போல் மாறுவேஷம் போட முடியாது. ஒவ்வொரு எண்ணின் பின்னால் உள்ள மாதிரி எண்ணிக்கை காட்டப்படுகிறது.
- எந்த ஒரு மாதிரியும் அனைத்தையும் வெல்வதில்லை. மிகவும் வலிமையான ஒட்டுமொத்த இலக்கிய திறன், மிகவும் நிலையான நம்பகத்தன்மை, சிறந்த செயல், மற்றும் மிகவும் தயாரான காதல் மற்றும் வெளிப்படையான எழுத்து வெவ்வேறு நெடுவரிசைகளில் உள்ளன — ஒரே ஒரு மாதிரியை தேர்ந்தெடுப்பதை விட ஒரு புத்தகத்தை மாதிரிகள் முழுவதும் திசைதிருப்புவதற்கான முழு வாதம் இதுவே.
- இது Novelmint ஒரு அத்தியாயத்தை கட்டும் போது ஒவ்வொரு இடத்திற்கும் மாதிரியை தேர்வு செய்யப் பயன்படுத்தும் அதே கட்டம் — மற்றும் ஒரு கட்டுமானத்தின் போது ஒரு பகுதியை மதிப்பிடும் அதே நீதிபதி அதை ஊட்டுகிறார், எனவே ஆசிரியர்கள் என்ஜினுடன் எழுதும்போது எண்கள் தொடர்ந்து புதுப்பிக்கப்படுகின்றன. இது ஒரு நேரடி வழிமுறை, பின்னோக்கி பார்க்கும் கூற்று அல்ல.
The benchmark
Frontier models on real novel prose
Live data · updated July 24, 2026
இது நேரடி தரவு, ஒரு முறை சோதனை அல்ல
கீழே உள்ள அட்டவணை நாங்கள் ஒருமுறை இயக்கி உறைய வைத்த அளவுகோல் அல்ல. இது தளம் இயங்கும் மதிப்பெண் களஞ்சியத்தின் நேரடி திட்டம்: ஒரு கட்டுமானத்தின் போது ஒரு பகுதியை மதிப்பிடும் அதே நீதிபதி இந்த கட்டத்தை ஊட்டுகிறார் — எனவே Novelmint-ல் எழுதப்படும் ஒவ்வொரு அத்தியாயமும் கவனிப்புகளை சேர்க்கிறது, மாதிரி எண்ணிக்கைகள் வளர்கின்றன, மற்றும் எண்கள் கூர்மையாகின்றன. அதிக ஆசிரியர்கள் என்ஜினுடன் கட்டுகையில், அளவுகோல் தொடர்ந்து புதுப்பிக்கப்படுகிறது — மேலே உள்ள தேதி வெறும் மிகவும் சமீபத்திய மறு அளவீட்டை குறிக்கிறது.
| Craft — how well it writes | Content — what it writes well | |||||||||
|---|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5LeadAnthropic | 85 | 84 | 87 | 86 | 83 | 87 | 84 | 84 | 82 | 78 |
| Claude Opus 4.8Anthropic | 82 | 87 | 72 | 87 | 84 | 86 | 77 | 79 | 81 | 57 |
| Fable 5Anthropic | 75 | 79 | 79 | 73 | 70 | 82 | 73 | 73 | 84 | 54 |
| GPT-5.6 SolOpenAI | 84 | 87 | 84 | 83 | 84 | 85 | 93 | 89 | 83 | 32 |
| Claude Sonnet 5Anthropic | 74 | 69 | 76 | 79 | 72 | 82 | 78 | 75 | 75 | 50 |
| Claude Haiku 4.5Anthropic | 65 | 72 | 60 | 64 | 63 | 71 | 63 | 68 | 68 | 51 |
| GPT-5.6 TerraOpenAI | 80 | 79 | 82 | 80 | 79 | 81 | 86 | 84 | 81 | 35 |
| GPT-4.1OpenAI | 68 | 71 | 64 | 70 | 68 | 67 | 70 | 62 | 70 | 63 |
| Gemini 3.1 ProGoogle | 73 | 65 | 72 | 77 | 80 | 74 | 81 | 77 | 76 | 77 |
| Gemini 3.5 FlashGoogle | 78 | 76 | 76 | 80 | 79 | 68 | 71 | 80 | 73 | 74 |
| Gemini 3.6 FlashGoogle | 74 | 71 | 73 | 78 | 74 | 74 | 80 | 71 | 72 | 73 |
| Grok 4.5xAI | 67 | 66 | 52 | 75 | 76 | 64 | 79 | 73 | 73 | 83 |
| Grok 4.3xAI | 65 | 67 | 61 | 74 | 60 | 73 | 78 | 71 | 73 | 78 |
கட்டத்தை எவ்வாறு படிப்பது
தலைப்பு எண் ஒட்டுமொத்த திறன் — ஒரு மாதிரியின் நான்கு செயல்திறன் அச்சுகளின் சராசரி, இது "அதன் உரைநடை எவ்வளவு நல்லது" என்பதற்கு மிகவும் நெருக்கமான விஷயம். வலதுபுறத்தில் உள்ள உள்ளடக்க அச்சுகள் சிறந்தது-அல்லது-மோசமான தரவரிசைகள் அல்ல; அவை மாதிரி என்ன பொருத்தமானது என்று சொல்கின்றன. அதிக உடல்நிலை மதிப்பெண் சுத்தமான செயலை குறிக்கிறது; குறைந்த காம மதிப்பெண் பொதுவாக பலவீனமான எழுத்தை விட மறுப்பு அல்லது மருத்துவ தட்டையைக் குறிக்கிறது — திறமை அல்ல, தயார்நிலை. மாதிரிகளை ஒப்பிட நெடுவரிசையில் திறனை படிக்கவும், ஒரு மாதிரி எங்கு வலிமையானது எங்கு இல்லை என்று பார்க்க வரிசையில் உள்ளடக்கத்தை படிக்கவும்.
Best AI for…
A straight answer for one kind of scene — or one genre
By what your scene needs
Not sure which to use?
Tell us what your book leans on
Pick what matters most for your story. We’ll rank the models for exactly that — the same way the build router chooses.
Choose one or more above to see your best-fit models.
Methodology
How the numbers are produced
சோதனை பதில்களை அல்ல, உண்மையான உரைநடையை உருவாக்குங்கள்
ஒவ்வொரு மாதிரியும் ஒரே இடங்களை எழுதுகிறது — தேவையான கூறுகள், தடைசெய்யப்பட்ட அறிவு, ஒரு பார்வைக் கோணம், மற்றும் ஒரு நாடகத்திற்கான இலக்கு கொண்ட காட்சிகள் — ஒரே நிலைமைகளில். ஒரு ஆசிரியர் படிக்கும் விதத்தில், ஒரு வினாடி வினா போல் செயல்படுகிறதா என்று அல்ல, அது புனைகதையாக என்ன உருவாக்குகிறது என்று நாங்கள் மதிப்பிடுகிறோம்.
குருட்டாக, ஒன்பது அச்சுகளில் மதிப்பிடுங்கள்
ஒரு நீதிபதி குழு ஒவ்வொரு பகுதியையும் நான்கு திறன் அச்சுகளில் (இலக்கிய, உரையாடல், நம்பகத்தன்மை, வேகம்) மற்றும் ஐந்து உள்ளடக்க அச்சுகளில் (உணர்ச்சி, உடல்நிலை, மோதல், காதல், காமம்) 0–100 மதிப்பிடுகிறது — எந்த மாதிரி எழுதியது என்று தெரியாமல். திறன் என்பது செயல்திறன் தரம்; உள்ளடக்கம் என்பது ஒரு வகை காட்சிக்கான பொருத்தம்.
நடுநிலை முன்னோடியை நோக்கி சுருக்குங்கள்
சில மாதிரிகளிலிருந்து கணக்கிடப்பட்ட ஒரு மூல சராசரி சத்தம். ஒவ்வொரு கலமும் அதன் ஆதாரம் எவ்வளவு மெல்லியது என்பதற்கு ஏற்ப நடுநிலை 70 அடிப்படையை நோக்கி இழுக்கப்படுகிறது — எனவே ஒரு ஆரம்ப, அதிர்ஷ்டமான அளவீடு போதுமான கவனிப்புகள் ஒரு இடத்தை சம்பாதிக்கும் வரை தோராயமாக சராசரியாக படிக்கப்படும். வெளியிடப்பட்ட எண் இந்த சுருக்கப்பட்ட மதிப்பு; மாதிரி எண்ணிக்கை அதன் பக்கத்தில் காட்டப்படுகிறது.
மடிக்கத் தொடருங்கள், கையால் மேலெழுத வேண்டாம்
புதிய நீதிபதி கவனிப்புகள் ஒரு இயங்கும் சராசரியில் மடிக்கப்படுகின்றன மற்றும் மாதிரி எண்ணிக்கை வளர்கிறது — எனவே கட்டம் காலப்போக்கில் கூர்மையாகிறது. எண்கள் கவனிப்புகளிலிருந்து மீண்டும் உருவாக்கப்படுகின்றன, கையால் தட்டச்சு செய்யப்படுவதில்லை — ஒரு மாதிரி பதிப்பு ஒரு மாற்றுப் பெயரின் கீழ் மாறும் போது அதன் கலங்கள் இரண்டு வெவ்வேறு மாதிரிகளை கலப்பதற்கு பதிலாக சுத்தமான மறு அளவீட்டிற்கு மீட்டமைக்கப்படுகின்றன.
Where this leads
இப்படிப்பட்ட அளவுகோல் ஏன் பயன்படுத்தக்கூடியது
ஒரு காட்சிக்கு வேறு மாதிரியை தேர்வு செய்வது ஒரு புத்தகம் ஒரே பாஸில் உருவாக்கப்படுவதற்கு பதிலாக தனித்தனி, விவரிக்கப்பட்ட அலகுகளில் கட்டப்பட்டால் மட்டுமே செயல்படும். அந்த அலகு இடம், மற்றும் வெவ்வேறு மாதிரிகள் வெவ்வேறு இடங்களை எழுதும்போது கதையை ஒத்திசைவாக வைத்திருப்பது கட்டுமானத்துடன் பயணிக்கும் ஒரு வில்-மற்றும்-நிறுவன நினைவின் வேலை. அளவுகோல் மதிப்பெண் பலகை; இடங்களும் வில் நினைவும் ஒரு புத்தகம் உண்மையில் அதை செலவிட அனுமதிப்பவை.
Questions
Frequently asked
- எந்த AI மாதிரி சிறந்த புனைகதை எழுதுகிறது?
- ஒட்டுமொத்த திறன் — உண்மையான நாவல் உரைநடையில் இலக்கிய, உரையாடல், நம்பகத்தன்மை மற்றும் வேகம் அச்சுகளின் சராசரி — மூலம், Claude Opus 4.8 தற்போது முன்னணியில் உள்ளது, GPT-5.6 Sol அதற்கு நெருக்கத்தில் உள்ளது. ஆனால் "சிறந்தது" காட்சியைப் பொறுத்தது: செயல், காதல் மற்றும் வெளிப்படையான உள்ளடக்கத்திற்கான அதிக மதிப்பெண்கள் வெவ்வேறு மாதிரிகளில் உள்ளன. இந்தப் பக்கத்திலுள்ள கட்டம் தற்போதைய நிலை மற்றும் ஒவ்வொரு எண்ணின் பின்னால் உள்ள மாதிரி எண்ணிக்கையைக் காட்டுகிறது.
- இந்த அளவுகோல் எவ்வாறு அளவிடப்படுகிறது?
- ஒவ்வொரு மாதிரியும் ஒரே நிலைமைகளில் ஒரே விவரிக்கப்பட்ட இடங்களை எழுதுகிறது, மற்றும் ஒரு குருட்டு நீதிபதி குழு உருவாக்கப்பட்ட உரைநடையை ஒன்பது அச்சுகளில் 0–100 மதிப்பிடுகிறது — நான்கு திறனுக்கு (இலக்கிய, உரையாடல், நம்பகத்தன்மை, வேகம்) மற்றும் ஐந்து உள்ளடக்க வகைக்கு (உணர்ச்சி, உடல்நிலை, மோதல், காதல், காமம்). மதிப்பெண்கள் மெல்லிய தரவு ஒரு எண்ணை அசைக்க முடியாதபடி நடுநிலை 70 அடிப்படையை நோக்கி நம்பிக்கையுடன் சுருக்கப்படுகின்றன, மற்றும் மாதிரி எண்ணிக்கை ஒவ்வொரு மதிப்பெண்ணின் பக்கத்திலும் காட்டப்படுகிறது.
- திறன் அச்சுகளுக்கும் உள்ளடக்க அச்சுகளுக்கும் என்ன வித்தியாசம்?
- திறன் அச்சுகள் ஒரு மாதிரி எவ்வளவு நன்றாக எழுதுகிறது என்பதை அளவிடுகின்றன, விஷயத்தைப் பொருட்படுத்தாமல் — வாக்கிய தரம், பாத்திர குரல், சுருக்கத்திற்கான நம்பகத்தன்மை, மற்றும் வேகக் கட்டுப்பாடு. உள்ளடக்க அச்சுகள் ஒரு வகை காட்சிக்கான பொருத்தத்தை அளவிடுகின்றன: உணர்ச்சி, உடல் செயல், மோதல், காதல், மற்றும் வெளிப்படையான உள்ளடக்கம். ஒரு மாதிரி அழகான வாக்கியங்கள் எழுதலாம், ஆனால் சண்டைக் காட்சியை மோசமாக கையாளலாம் — எனவே இரண்டு குடும்பங்களும் தனித்தனியாக மதிப்பிடப்பட்டு காட்டப்படுகின்றன.
- ஏன் ஒரே ஒரு சிறந்த மாதிரியை தேர்வு செய்து எல்லாவற்றிற்கும் பயன்படுத்தக்கூடாது?
- ஏனென்றால் எந்த மாதிரியும் ஒவ்வொரு அச்சிலும் வெல்வதில்லை. மிகவும் வலிமையான இலக்கிய திறன், சிறந்த செயல், மற்றும் மிகவும் திறமையான காதல் அல்லது வெளிப்படையான எழுத்து வெவ்வேறு மாதிரிகளைச் சேர்ந்தது. Novelmint ஒரு புத்தகத்தை மாதிரிகள் முழுவதும் இடம் தோறும் திசைதிருப்புகிறது — பெரும்பகுதியை ஒத்திசைவுக்காக ஒரு தொடர் குரலில் வைத்து, அதை சம்பாதிக்கும் குறிப்பிட்ட இடங்களில் மட்டும் வலிமையான மாதிரியிடம் விலகுகிறது — இது இந்த கட்டம் இருப்பதால் மட்டுமே சாத்தியம்.
- குறைந்த மதிப்பெண் என்பது ஒரு மாதிரி மோசமானது என்று பொருளா?
- அவசியமில்லை. குறைந்த உள்ளடக்க மதிப்பெண் மாதிரி திறமையானது ஆனால் தயாரில்லாமல் இருக்கிறது என்று பொருளாகலாம் — பெரும்பாலான மாதிரிகள் காமத்தில் குறைந்த மதிப்பெண் பெறுகின்றன, ஏனென்றால் அவை மறுக்கின்றன அல்லது மருத்துவமாகி விடுகின்றன, திறமை குறைவால் அல்ல. மற்றும் குறைந்த நம்பிக்கை மதிப்பெண் (சில மாதிரிகள்) நடுநிலை அடிப்படையை நோக்கி சுருக்கப்படுகிறது — எனவே அது "இன்னும் நிரூபிக்கப்படவில்லை" என்று படிக்கப்படுகிறது, "பலவீனமாக நிரூபிக்கப்பட்டது" அல்ல. மதிப்பெண்ணை எப்போதும் அதன் மாதிரி எண்ணிக்கையுடன் படிக்கவும்.
- அளவுகோல் எவ்வளவு அடிக்கடி புதுப்பிக்கப்படுகிறது?
- தொடர்ச்சியாக. கட்டம் தளத்தின் மதிப்பெண் களஞ்சியத்தின் நேரடி திட்டம்: Novelmint ஒரு அத்தியாயத்தை கட்டும்போது ஒரு பகுதியை மதிப்பிடும் அதே நீதிபதி அதன் கவனிப்புகளை மீண்டும் மடிக்கிறார் — எனவே ஆசிரியர்கள் என்ஜினைப் பயன்படுத்தும்போது எண்கள் நகர்கின்றன மற்றும் மாதிரி எண்ணிக்கைகள் வளர்கின்றன. பக்கம் மிகவும் சமீபத்திய மறு அளவீட்டின் தேதியைக் காட்டுகிறது. புதிய மாதிரி பதிப்புகள் அவை மாற்றிய மாதிரியுடன் கலக்கப்படுவதற்கு பதிலாக புதிதாக மீண்டும் அளவிடப்படுகின்றன — எனவே ஒரு பதிப்பு மாற்றம் ஒரு நெடுவரிசையை அமைதியாக சீர்கெட்டதாக மாற்றாது.
What this page does not claim
- இந்த அளவுகோல் புனைகதைக்கான உரைநடை தரம் மற்றும் உள்ளடக்க பொருத்தத்தை மட்டுமே அளவிடுகிறது. மாதிரியின் தர்க்கம், குறியீடு, கணிதம், உண்மை துல்லியம், அல்லது எழுத்துச் சூழலுக்கு வெளியே பாதுகாப்பு பற்றி எதுவும் சொல்வதில்லை.
- மதிப்பெண்கள் நீதிபதியிடப்பட்ட தொகுப்பு மற்றும் பயன்படுத்தப்பட்ட உடனடி செய்திகளுக்கு தொடர்புடையவை — மாதிரி வழங்குநர்களால் அங்கீகரிக்கப்பட்ட முழுமையான அல்லது அதிகாரப்பூர்வ மதிப்பீடு அல்ல. மாதிரி பெயர்கள் மற்றும் வர்த்தக முத்திரைகள் அவற்றின் உரிமையாளர்களுக்கு சொந்தமானவை.
- அதிக ஒட்டுமொத்த திறன் மதிப்பெண் என்பது ஒரு மாதிரி ஒவ்வொரு புத்தகத்திற்கும் சரியான தேர்வு என்று பொருளல்ல — குரல், வகை, உள்ளடக்க தேவைகள், மற்றும் செலவு ஆகியவை முக்கியம் — இதனால்தான் Novelmint ஒரே ஒன்றை முடிசூட்டுவதற்கு பதிலாக மாதிரிகள் முழுவதும் திசைதிருப்புகிறது.
- குறைந்த மாதிரி கலங்கள் தற்காலிகமானவை. ஒரு எண் சில கவனிப்புகளை கொண்டிருக்கும் இடத்தில் அது நடுநிலை அடிப்படையை நோக்கி சுருக்கப்பட்டு கொடியிடப்படுகிறது, மேலும் கவனிப்புகள் மடிக்கப்படும்போது அது நகரும்.
தொடர்புடையவை
செயல்பாட்டுக் காட்சிகளுக்கு சிறந்த AI
எந்த AI ஒரு சண்டை அல்லது துரத்தலை தெளிவாகவும் உறுதியாகவும் வைத்திருக்கிறது. உடல் இயக்கத்தில் தரவரிசை.
மோதல் காட்சிகளுக்கு சிறந்த AI
எந்த AI ஒரு வாக்குவாதம் அல்லது எதிர்நிலையை இறுகவும் உயர்வாகவும் வைத்திருக்கிறது. அளவிடப்பட்ட மோதலில் தரவரிசை.
உணர்ச்சிக் காட்சிகளுக்கு சிறந்த AI
எந்த AI ஒரு உணர்வு-சார்ந்த காட்சியை வெறும் விவரிப்பாக இல்லாமல் உயிரோட்டமாக்குகிறது. உணர்ச்சியில் தரவரிசை.
வெளிப்படையான காட்சிகளுக்கான சிறந்த AI
எந்த AI உண்மையில் வெளிப்படையான பெரியவர் உள்ளடக்கத்தை எழுதும் — எவை மறுக்கும். விருப்பத்தில் தரவரிசைப்படுத்தப்பட்டது.
எந்த மாதிரியை பயன்படுத்த வேண்டும் என்று யூகிப்பதை நிறுத்துங்கள். புத்தகம் தேர்வு செய்யட்டும்.
Novelmint ஒவ்வொரு இடத்தையும் இந்த கட்டம் மிகவும் பொருத்தமானது என்று சொல்லும் மாதிரிக்கு திசைதிருப்புகிறது. உங்கள் முதல் அத்தியாயம் இலவசம்.