Valumigo

LMArena · Texto dentro de imágenes

Recopilamos y mostramos periódicamente datos públicos de benchmarks (clasificaciones por votos de usuarios de LMArena, puntuaciones de pruebas de Epoch AI y clasificaciones de uso de OpenRouter). Cada clasificación indica tanto la fecha de publicación como la fecha de recopilación. Las puntuaciones no las asigna este sitio.

Las puntuaciones de LMArena se basan en votos de personas que comparan las respuestas de dos modelos y eligen la mejor (sistema Elo). Si la diferencia queda dentro del intervalo de confianza, considera que los modelos tienen un nivel similar.

Cómo interpretar esta clasificación

Qué mide: Es una clasificación basada en votos de preferencia para prompts que solicitan explícitamente generar texto legible y correcto dentro de una imagen.

Cómo interpretar la puntuación: Es una puntuación relativa de las imágenes preferidas por los usuarios para esos prompts. No es una tasa de aciertos que evalúe por separado la precisión de los caracteres.

Precauciones: Esta clasificación por sí sola no permite determinar la capacidad de representar caracteres coreanos (Hangul); compruébala por separado con prompts en coreano (Hangul).

Claves para interpretar esta clasificación

  • Los intervalos de confianza del 95% de gpt-image-2.5-sunburst, en 1.º lugar, y gpt-image-2.5-flare, en 2.º, no se solapan. En esta agregación, la evidencia de que el 1.º lleva ventaja es relativamente clara.
  • Entre los 10 modelos mejor clasificados, OpenAI tiene la mayor cantidad, con 3 modelos.
  • El modelo en 1.º lugar recibió 3,699 votos y esta clasificación incluye 50 modelos.

Texto dentro de imágenes LMArena

Publicado el 2026-09-24 · Obtenido el 2026-10-04

112012001280136014401520
Ogpt-image-2.5-sunburst
1467
Ogpt-image-2.5-flare
1435
Ogpt-image-2 (medium)
1425
Mmai-image-2.6
1371
xgrok-imagine-image-2.0 (low)
1341
Rreve-2.1
1340
Metamuse-image
1299
Rreve-2.0
1299
Googlegemini-3.1-flash-image (nano-banana-2) [web-search]
1295
Alibabaqwen-image-3.0-pro
1283
Mmai-image-2.5
1281
Googlegemini-3.1-flash-lite-image (nano-banana-2-lite)
1274
Googlegemini-3-pro-image-2k (nano-banana-pro)
1271
Alibabaqwen-image-2.1
1262
ByteDanceseedream-5.0-pro
1255
Googlegemini-3-pro-image-preview (nano-banana-pro)
1254
Ogpt-image-1.5-high-fidelity
1253
Iideogram-4.0-quality
1238
Luni-1.1-max
1219
Alibabaqwen-image-2.0-pro-2026-06-22
1202

Los puntos indican la puntuación y las líneas horizontales, el intervalo de confianza del 95%. Si las líneas se solapan, los resultados son prácticamente equivalentes. El gráfico muestra solo la configuración de razonamiento de cada modelo (high, max, etc.) con la puntuación más alta. La tabla muestra las posiciones de todas las configuraciones.

Mejor posición por empresa

  • OOpenAIgpt-image-2.5-sunburst#1
  • MMicrosoft AImai-image-2.6#4
  • xxAIgrok-imagine-image-2.0 (low)#5
  • RRevereve-2.1#6
  • MetaMetamuse-image#7
  • GoogleGooglegemini-3.1-flash-image (nano-banana-2) [web-search]#9
  • AlibabaAlibabaqwen-image-3.0-pro#10
  • ByteDanceByteDanceseedream-5.0-pro#15
  • IIdeogramideogram-4.0-quality#18
Ver tabla (los 50 mejores)
PuestoModeloDesarrolladorPuntuaciónIntervalo de confianza del 95%Votos
1#1Ogpt-image-2.5-sunburstOpenAI14671455–14803,699
2#2Ogpt-image-2.5-flareOpenAI14351423–14483,360
3#3Ogpt-image-2 (medium)OpenAI14251419–143232,795
4#4Mmai-image-2.6Microsoft AI13711362–13816,053
5#5xgrok-imagine-image-2.0 (low)xAI13411329–13542,354
6#6Rreve-2.1Reve13401328–13522,756
7#7Metamuse-imageMeta12991292–130711,345
8#8Rreve-2.0Reve12991290–13085,468
9#9Googlegemini-3.1-flash-image (nano-banana-2) [web-search]Google12951289–130117,342
10#10Alibabaqwen-image-3.0-proAlibaba12831273–12933,643
11#11Mmai-image-2.5Microsoft AI12811275–128720,912
12#12Googlegemini-3.1-flash-lite-image (nano-banana-2-lite)Google12741265–12835,826
13#13Googlegemini-3-pro-image-2k (nano-banana-pro)Google12711266–127555,545
14#14Alibabaqwen-image-2.1Alibaba12621247–12781,361
15#15ByteDanceseedream-5.0-proByteDance12551249–126127,232
16#16Googlegemini-3-pro-image-preview (nano-banana-pro)Google12541247–126225,697
17#17Ogpt-image-1.5-high-fidelityOpenAI12531248–125859,309
18#18Iideogram-4.0-qualityIdeogram12381232–124417,299
19#19Luni-1.1-maxLuma AI12191210–12284,796
20#20Luni-1.1Luma AI12071201–121413,698
21#21Alibabaqwen-image-2.0-pro-2026-06-22Alibaba12021193–12114,374
22#22Rreve-v1.5Reve11871181–119313,637
23#23xgrok-imagine-imagexAI11841180–118993,401
24#24xgrok-imagine-image-proxAI11821177–118835,037
25#25Mmai-image-2Microsoft AI11771170–118319,396
26#26Bflux-2-flexBlack Forest Labs11721167–117752,342
27#27Bflux-2-maxBlack Forest Labs11661160–117142,386
28#28Rrecraft-v4.1-utility-proRecraft11621144–1179956
29#29Bflux-2-devBlack Forest Labs11581153–116424,410
30#30Rrecraft-v4.1-proRecraft11561139–1173956
31#31Bflux-2-proBlack Forest Labs11551151–116069,022
32#32Googlegemini-2.5-flash-image-preview (nano-banana)Google11541150–1157234,500
33#33Thunyuan-image-3.0Tencent11491144–115452,522
34#34Alibabawan2.6-t2iAlibaba11491144–115379,115
35#35Googleimagen-ultra-4.0-generate-001Google11481143–115490,345
36#36NVIDIACosmos3-Super-Text2Image (Agentic)NVIDIA11451134–11572,436
37#37ByteDanceseedream-4.5ByteDance11431139–114797,172
38#38ByteDanceseedream-4-2kByteDance11431131–11543,099
39#39Alibabawan2.5-t2i-previewAlibaba11421138–114688,333
40#40Rrecraft-v4Recraft11391134–114445,141
41#41ByteDanceseedream-5.0-liteByteDance11351131–114043,258
42#42Hhidream-o1-imageHidream11341129–114018,944
43#43Kkrea-2-mediumKrea11271121–113416,666
44#44ByteDanceseedream-4-falByteDance11241113–11352,747
45#45Alibabaqwen-image-2512Alibaba11231118–112830,851
46#46Googleimagen-4.0-generate-001Google11231119–1127141,558
47#47Alibabawan2.7-image-proAlibaba11211114–112712,680
48#48NVIDIACosmos3-Super-Text2ImageNVIDIA11191110–11285,365
49#49Alibabawan2.7-imageAlibaba11161109–112312,705
50#50Ogpt-image-1OpenAI11151110–111972,150

Datos: LMArena leaderboard dataset (CC BY 4.0). Cambios: Solo se muestran los 50 primeros de cada clasificación; las puntuaciones se redondean. https://huggingface.co/datasets/lmarena-ai/leaderboard-datasetLos logotipos son marcas comerciales de sus respectivas empresas y solo se usan para identificarlas (iconos: Simple Icons).Datos: Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings