Valumigo

LMArena · Rendu du texte dans les images

Nous récupérons régulièrement les données publiques de benchmarks (classements issus des votes des utilisateurs de LMArena, scores aux tests d’Epoch AI et classements d’utilisation d’OpenRouter) pour les afficher. Chaque classement indique sa date de publication et sa date de récupération. Ces scores ne sont pas attribués par ce site.

Les scores LMArena proviennent des votes de personnes qui comparent les réponses de deux modèles et choisissent la meilleure (méthode Elo). Si l’écart entre les scores reste dans l’intervalle de confiance, considérez les modèles comme de niveau similaire.

Comment lire ce classement

Ce qui est mesuré : Ce classement repose sur les votes de préférence pour des prompts demandant explicitement de générer du texte lisible et exact dans une image.

Comment lire le score : Il s’agit d’un score relatif des images préférées par les utilisateurs pour ces prompts. Ce n’est pas un taux de réussite mesurant séparément l’exactitude des caractères.

Points à surveiller : Ce classement seul ne permet pas de conclure sur la qualité du rendu des caractères coréens (Hangul). Vérifiez-la séparément avec des prompts en coréen (Hangul).

Ce que révèle ce classement

  • Les intervalles de confiance à 95% de gpt-image-2.5-sunburst, en 1re place, et de gpt-image-2.5-flare, en 2e place, ne se chevauchent pas. Cette agrégation fournit des éléments relativement clairs en faveur de l’avance du premier.
  • Parmi les 10 premiers, les modèles de OpenAI sont les plus nombreux, avec 3 modèles.
  • Le modèle en 1re place a reçu 3,699 votes, et ce classement comprend 50 modèles.

Rendu du texte dans les images LMArena

Publié le 2026-09-24 · Récupéré le 2026-10-04

112012001280136014401520
Ogpt-image-2.5-sunburst
1467
Ogpt-image-2.5-flare
1435
Ogpt-image-2 (medium)
1425
Mmai-image-2.6
1371
xgrok-imagine-image-2.0 (low)
1341
Rreve-2.1
1340
Metamuse-image
1299
Rreve-2.0
1299
Googlegemini-3.1-flash-image (nano-banana-2) [web-search]
1295
Alibabaqwen-image-3.0-pro
1283
Mmai-image-2.5
1281
Googlegemini-3.1-flash-lite-image (nano-banana-2-lite)
1274
Googlegemini-3-pro-image-2k (nano-banana-pro)
1271
Alibabaqwen-image-2.1
1262
ByteDanceseedream-5.0-pro
1255
Googlegemini-3-pro-image-preview (nano-banana-pro)
1254
Ogpt-image-1.5-high-fidelity
1253
Iideogram-4.0-quality
1238
Luni-1.1-max
1219
Alibabaqwen-image-2.0-pro-2026-06-22
1202

Les points indiquent les scores, les lignes horizontales les intervalles de confiance à 95 %. Si les lignes se chevauchent, les performances sont globalement similaires. Le graphique affiche uniquement le meilleur score parmi les réglages de raisonnement d’un même modèle (high, max, etc.). Le tableau présente les classements de tous les réglages.

Meilleur classement par entreprise

  • OOpenAIgpt-image-2.5-sunburst#1
  • MMicrosoft AImai-image-2.6#4
  • xxAIgrok-imagine-image-2.0 (low)#5
  • RRevereve-2.1#6
  • MetaMetamuse-image#7
  • GoogleGooglegemini-3.1-flash-image (nano-banana-2) [web-search]#9
  • AlibabaAlibabaqwen-image-3.0-pro#10
  • ByteDanceByteDanceseedream-5.0-pro#15
  • IIdeogramideogram-4.0-quality#18
Voir le tableau (top 50)
RangModèleDéveloppeurScoreIntervalle de confiance à 95%Nombre de votes
1#1Ogpt-image-2.5-sunburstOpenAI14671455–14803,699
2#2Ogpt-image-2.5-flareOpenAI14351423–14483,360
3#3Ogpt-image-2 (medium)OpenAI14251419–143232,795
4#4Mmai-image-2.6Microsoft AI13711362–13816,053
5#5xgrok-imagine-image-2.0 (low)xAI13411329–13542,354
6#6Rreve-2.1Reve13401328–13522,756
7#7Metamuse-imageMeta12991292–130711,345
8#8Rreve-2.0Reve12991290–13085,468
9#9Googlegemini-3.1-flash-image (nano-banana-2) [web-search]Google12951289–130117,342
10#10Alibabaqwen-image-3.0-proAlibaba12831273–12933,643
11#11Mmai-image-2.5Microsoft AI12811275–128720,912
12#12Googlegemini-3.1-flash-lite-image (nano-banana-2-lite)Google12741265–12835,826
13#13Googlegemini-3-pro-image-2k (nano-banana-pro)Google12711266–127555,545
14#14Alibabaqwen-image-2.1Alibaba12621247–12781,361
15#15ByteDanceseedream-5.0-proByteDance12551249–126127,232
16#16Googlegemini-3-pro-image-preview (nano-banana-pro)Google12541247–126225,697
17#17Ogpt-image-1.5-high-fidelityOpenAI12531248–125859,309
18#18Iideogram-4.0-qualityIdeogram12381232–124417,299
19#19Luni-1.1-maxLuma AI12191210–12284,796
20#20Luni-1.1Luma AI12071201–121413,698
21#21Alibabaqwen-image-2.0-pro-2026-06-22Alibaba12021193–12114,374
22#22Rreve-v1.5Reve11871181–119313,637
23#23xgrok-imagine-imagexAI11841180–118993,401
24#24xgrok-imagine-image-proxAI11821177–118835,037
25#25Mmai-image-2Microsoft AI11771170–118319,396
26#26Bflux-2-flexBlack Forest Labs11721167–117752,342
27#27Bflux-2-maxBlack Forest Labs11661160–117142,386
28#28Rrecraft-v4.1-utility-proRecraft11621144–1179956
29#29Bflux-2-devBlack Forest Labs11581153–116424,410
30#30Rrecraft-v4.1-proRecraft11561139–1173956
31#31Bflux-2-proBlack Forest Labs11551151–116069,022
32#32Googlegemini-2.5-flash-image-preview (nano-banana)Google11541150–1157234,500
33#33Thunyuan-image-3.0Tencent11491144–115452,522
34#34Alibabawan2.6-t2iAlibaba11491144–115379,115
35#35Googleimagen-ultra-4.0-generate-001Google11481143–115490,345
36#36NVIDIACosmos3-Super-Text2Image (Agentic)NVIDIA11451134–11572,436
37#37ByteDanceseedream-4.5ByteDance11431139–114797,172
38#38ByteDanceseedream-4-2kByteDance11431131–11543,099
39#39Alibabawan2.5-t2i-previewAlibaba11421138–114688,333
40#40Rrecraft-v4Recraft11391134–114445,141
41#41ByteDanceseedream-5.0-liteByteDance11351131–114043,258
42#42Hhidream-o1-imageHidream11341129–114018,944
43#43Kkrea-2-mediumKrea11271121–113416,666
44#44ByteDanceseedream-4-falByteDance11241113–11352,747
45#45Alibabaqwen-image-2512Alibaba11231118–112830,851
46#46Googleimagen-4.0-generate-001Google11231119–1127141,558
47#47Alibabawan2.7-image-proAlibaba11211114–112712,680
48#48NVIDIACosmos3-Super-Text2ImageNVIDIA11191110–11285,365
49#49Alibabawan2.7-imageAlibaba11161109–112312,705
50#50Ogpt-image-1OpenAI11151110–111972,150

Données : LMArena leaderboard dataset (CC BY 4.0). Modifications : Seuls les 50 premiers de chaque classement sont affichés. Les scores sont arrondis.. https://huggingface.co/datasets/lmarena-ai/leaderboard-datasetLes logos sont des marques de leurs entreprises respectives et servent uniquement à les distinguer (icônes : Simple Icons).Données : Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings