Valumigo

LMArena · Retouche d’images

Nous récupérons régulièrement les données publiques de benchmarks (classements issus des votes des utilisateurs de LMArena, scores aux tests d’Epoch AI et classements d’utilisation d’OpenRouter) pour les afficher. Chaque classement indique sa date de publication et sa date de récupération. Ces scores ne sont pas attribués par ce site.

Les scores LMArena proviennent des votes de personnes qui comparent les réponses de deux modèles et choisissent la meilleure (méthode Elo). Si l’écart entre les scores reste dans l’intervalle de confiance, considérez les modèles comme de niveau similaire.

Comment lire ce classement

Ce qui est mesuré : Ce classement repose sur des votes comparant les résultats de deux modèles à partir d’une image et d’une consigne de retouche, comme un changement de fond ou de couleur.

Comment lire le score : Il s’agit d’un score relatif des retouches préférées par les utilisateurs. Le respect des consignes et la préservation de l’image originale ne sont pas notés séparément.

Points à surveiller : Pour vérifier si un modèle convient aux retouches souhaitées, comparez directement les résultats avec la même image et la même consigne.

Ce que révèle ce classement

  • Les intervalles de confiance à 95% de gpt-image-2.5-sunburst, en 1re place, et de gpt-image-2.5-flare, en 2e place, ne se chevauchent pas. Cette agrégation fournit des éléments relativement clairs en faveur de l’avance du premier.
  • Parmi les 10 premiers, les modèles de OpenAI sont les plus nombreux, avec 3 modèles.
  • Le modèle en 1re place a reçu 47,289 votes, et ce classement comprend 50 modèles.

Retouche d’images LMArena

Publié le 2026-09-30 · Récupéré le 2026-10-04

13201380144015001560
Ogpt-image-2.5-sunburst
1522
Ogpt-image-2.5-flare
1478
Ogpt-image-2 (medium)
1461
xgrok-imagine-image-2.0 (low)
1427
Mmai-image-2.6
1427
Metamuse-image
1403
Mmai-image-2.5
1401
ByteDanceseedream-5.0-pro
1394
xgrok-imagine-image-quality (20260519)
1391
Googlegemini-3-pro-image-2k (nano-banana-pro)
1390
Ochatgpt-image-latest-high-fidelity (20251216)
1389
Googlegemini-3.1-flash-image (nano-banana-2) [web-search]
1387
Googlegemini-3-pro-image-preview (nano-banana-pro)
1386
Rreve-2.1
1374
Ogpt-image-1.5-high-fidelity
1370
Alibabaqwen-image-2.1
1366
Rreve-2.0
1359
Iideogram-4.5
1351
Luni-1.1-max
1334
xgrok-imagine-image
1329

Les points indiquent les scores, les lignes horizontales les intervalles de confiance à 95 %. Si les lignes se chevauchent, les performances sont globalement similaires. Le graphique affiche uniquement le meilleur score parmi les réglages de raisonnement d’un même modèle (high, max, etc.). Le tableau présente les classements de tous les réglages.

Meilleur classement par entreprise

  • OOpenAIgpt-image-2.5-sunburst#1
  • xxAIgrok-imagine-image-2.0 (low)#4
  • MMicrosoft AImai-image-2.6#5
  • MetaMetamuse-image#6
  • ByteDanceByteDanceseedream-5.0-pro#8
  • GoogleGooglegemini-3-pro-image-2k (nano-banana-pro)#10
  • RRevereve-2.1#14
  • AlibabaAlibabaqwen-image-2.1#16
  • IIdeogramideogram-4.5#18
Voir le tableau (top 50)
RangModèleDéveloppeurScoreIntervalle de confiance à 95%Nombre de votes
1#1Ogpt-image-2.5-sunburstOpenAI15221517–152847,289
2#2Ogpt-image-2.5-flareOpenAI14781473–148444,792
3#3Ogpt-image-2 (medium)OpenAI14611458–1465293,819
4#4xgrok-imagine-image-2.0 (low)xAI14271422–143236,022
5#5Mmai-image-2.6Microsoft AI14271422–143241,512
6#6Metamuse-imageMeta14031399–1408130,653
7#7Mmai-image-2.5Microsoft AI14011397–1405190,356
8#8ByteDanceseedream-5.0-proByteDance13941391–1397270,020
9#9xgrok-imagine-image-quality (20260519)xAI13911386–139738,256
10#10Googlegemini-3-pro-image-2k (nano-banana-pro)Google13901388–1393638,610
11#11Ochatgpt-image-latest-high-fidelity (20251216)OpenAI13891386–1391617,941
12#12Googlegemini-3.1-flash-image (nano-banana-2) [web-search]Google13871384–1391216,640
13#13Googlegemini-3-pro-image-preview (nano-banana-pro)Google13861383–1389540,778
14#14Rreve-2.1Reve13741368–138020,823
15#15Ogpt-image-1.5-high-fidelityOpenAI13701367–1372642,272
16#16Alibabaqwen-image-2.1Alibaba13661360–137214,617
17#17Rreve-2.0Reve13591352–136519,291
18#18Iideogram-4.5Ideogram13511343–13605,441
19#19Luni-1.1-maxLuma AI13341329–133943,451
20#20xgrok-imagine-imagexAI13291327–1332737,207
21#21Luni-1.1Luma AI13151311–1318177,667
22#22Googlegemini-3.1-flash-lite-image (nano-banana-2-lite)Google13141309–131865,764
23#23Alibabaqwen-image-2.0-pro-2026-06-22Alibaba13031299–130856,781
24#24Thunyuan-image-3.0-instructTencent13031299–1306331,592
25#25Alibabawan2.7-image-proAlibaba13031299–130743,992
26#26ByteDanceseedream-4.5ByteDance13021300–13041,266,531
27#27Alibabawan2.7-imageAlibaba13011297–130544,814
28#28ByteDanceseedream-5.0-liteByteDance12941291–1297446,300
29#29Googlegemini-2.5-flash-image-preview (nano-banana)Google12931291–129511,355,727
30#30ByteDanceseedream-4-2kByteDance12701264–1277210,076
31#31Rreve-v1.1Reve12621259–1264672,675
32#32Bflux-2-maxBlack Forest Labs12621258–1265375,959
33#33Klingkling-image-o1Kling12511248–1255143,692
34#34Bflux-2-proBlack Forest Labs12451243–1248624,352
35#35Alibabaqwen-image-editAlibaba12411239–12442,022,077
36#36Rreve-v1Reve12351230–1239395,314
37#37Alibabaqwen-image-edit-2511Alibaba12341231–1237485,308
38#38Alibabawan2.6-imageAlibaba12311228–1233664,189
39#39Bflux-2-flexBlack Forest Labs12251222–1228443,953
40#40Bflux-2-klein-9bBlack Forest Labs12251222–1228540,833
41#41Bflux-2-devBlack Forest Labs12251221–1229254,450
42#42ByteDanceseedream-4-high-res-falByteDance12171214–12201,229,943
43#43?p-image-edit?12111208–1214359,965
44#44ByteDanceseedream-4-falByteDance12101204–1216152,114
45#45Rreve-v1.1-fastReve12071204–1210553,361
46#46Rreve-edit-fastReve11981194–1202230,289
47#47Bflux-2-klein-4bBlack Forest Labs11871185–1190541,422
48#48Bflux-1-kontext-maxBlack Forest Labs11811178–1183390,877
49#49Alibabawan2.5-i2i-previewAlibaba11811178–1183715,740
50#50Bflux-1-kontext-proBlack Forest Labs11761174–11796,404,790

Données : LMArena leaderboard dataset (CC BY 4.0). Modifications : Seuls les 50 premiers de chaque classement sont affichés. Les scores sont arrondis.. https://huggingface.co/datasets/lmarena-ai/leaderboard-datasetLes logos sont des marques de leurs entreprises respectives et servent uniquement à les distinguer (icônes : Simple Icons).Données : Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings