Mesa en vivo, actualizada a diario

Ranking de modelos de IA: quién es el n.º 1 ahora mismo

La tabla que la gente cita de verdad, el precio de cada modelo y los lanzamientos del mes, en una página que se actualiza sola.

A 13 de septiembre de 2026, Claude Fable 5.1 (max) de Anthropic lidera la tabla de texto de LMArena, con Claude Opus 5 (max) y Claude Opus 4.6 (high) muy cerca.

Entre los modelos de marca, GLM 5.3 Flash es el más barato de usar, a 0,25 US$ por millón de tokens de salida, y Claude Fable 5.1 el más caro, a 50,00 US$.

La cabeza de la tabla suele ser un empate estadístico: cuando los márgenes de dos modelos se solapan, los votos no pueden separarlos.

La tabla

La tabla de texto de LMArena: la gente chatea con dos modelos anónimos a la vez y vota la mejor respuesta. Una fila por modelo; los niveles de razonamiento se agrupan en el mejor.

#ModeloFabricantePuntuaciónVotos
1 Claude Fable 5.1 (max) Anthropic 1508 ±9 5783
2 Claude Opus 5 (max) Anthropic 1505 ±5 20.706
3 Claude Opus 4.6 (high) Anthropic 1503 ±4 71.993
4 Gemini 3.8 Flash (high) Google 1495 ±9 5076
5 Claude Fable 5 Anthropic 1493 ±5 30.057
6 Gemini 3.7 Flash (high) Google 1490 ±9 5640
7 Claude Opus 4.7 (high) Anthropic 1490 ±4 60.002
8 Muse Spark 1.3 (max) Meta 1490 ±9 4723
9 Muse Spark 1.2 (xhigh) Meta 1489 ±11 3227
10 Gemini 3.5 Flash (high) Google 1482 ±4 38.257
11 Qwen3.8 (max) Alibaba 1481 ±6 16.670
12 Muse Spark 1.1 Meta 1480 ±5 27.615
13 Gemini 3.1 Pro Preview Google 1480 ±3 106.951
14 Gemini 3 Pro Google 1479 ±4 40.654
15 Gemini 3.6 Flash (high) Google 1476 ±5 26.445
16 GLM 5.3 (max)Pesos abiertos Z.ai 1475 ±6 10.960
17 Qwen3.7 Max Preview Alibaba 1474 ±10 3705
18 Muse Spark Meta 1473 ±6 13.565
19 Kimi K3 (max)Pesos abiertos Moonshot 1472 ±5 20.987
20 GLM 5.3 FlashPesos abiertos Z.ai 1472 ±7 10.038
21 Qwen3.5 Max Preview Alibaba 1471 ±5 21.476
22 GPT-5.5 (high) OpenAI 1471 ±4 64.924
23 GPT-5.4 (high) OpenAI 1470 ±4 60.537
24 ERNIE 5.1 Baidu 1468 ±5 37.058
25 GLM 5.2 (max)Pesos abiertos Z.ai 1467 ±5 36.798

Tabla de texto de LMArena, publicada el 13 de septiembre de 2026. La puntuación es la valoración de la arena con su margen del 95 %; las filas cuyos márgenes se solapan están empatadas estadísticamente.

Mejores modelos de pesos abiertos

Los mismos votos de LMArena, solo modelos cuyos pesos puedes descargar y ejecutar tú mismo. El número gris es su puesto en la tabla general.

#ModeloFabricantePuntuaciónVotos
1 GLM 5.3 (max)n.º 20 general Z.ai 1475 ±6 10.960
2 Kimi K3 (max)n.º 23 general Moonshot 1472 ±5 20.987
3 GLM 5.3 Flashn.º 24 general Z.ai 1472 ±7 10.038
4 GLM 5.2 (max)n.º 29 general Z.ai 1467 ±5 36.798
5 Mimo V2.5 Pron.º 32 general Xiaomi 1465 ±4 60.919
6 GLM 5.1n.º 33 general Z.ai 1462 ±4 48.901
7 Kimi K2.6n.º 38 general Moonshot 1455 ±5 37.502
8 DeepSeek V4 Pron.º 43 general DeepSeek 1451 ±4 54.130
9 GLM 5n.º 51 general Z.ai 1446 ±5 27.605
10 Kimi K2.5 (thinking)n.º 53 general Moonshot 1446 ±4 70.513
11 DeepSeek V4 Pro High Previewn.º 54 general DeepSeek 1445 ±4 51.485
12 Nvidia Nemotron 3 Ultra 550b A55B Nvfp4n.º 55 general Nvidia 1445 ±7 10.693
13 DeepSeek V4 Pro High 20260813n.º 58 general DeepSeek 1444 ±7 9008
14 Gemma 4 31bn.º 64 general Google 1442 ±8 5894
15 Hy3n.º 65 general Tencent 1441 ±8 8047

Tabla de texto de LMArena, publicada el 13 de septiembre de 2026. La puntuación es la valoración de la arena con su margen del 95 %; las filas cuyos márgenes se solapan están empatadas estadísticamente.

Advertisement

Cuánto cuesta cada modelo

Precio de lista por millón de tokens del modelo actual de cada familia, del más barato al más caro. Un millón de tokens son unas 750.000 palabras de texto, de entrada o de salida.

ModeloFabricanteEntradaSalida1 $ compraContexto
GLM 5.3 Flash Z.ai 0,075 US$ 0,25 US$ ≈3 M palabras 1,3 M
DeepSeek V4.1 Flash DeepSeek 0,15 US$ 0,60 US$ ≈1,3 M palabras 1 M
GPT-5.6 Luna OpenAI 0,20 US$ 1,20 US$ ≈625 mil palabras 1,1 M
DeepSeek V4 Pro 0813 DeepSeek 0,66 US$ 1,98 US$ ≈378,8 mil palabras 1 M
Gemini 3.8 Flash Google 0,75 US$ 3,75 US$ ≈200 mil palabras 1 M
GPT-5.4 Mini OpenAI 0,75 US$ 4,50 US$ ≈166,7 mil palabras 400 mil
Claude Haiku 4.5 Anthropic 1,00 US$ 5,00 US$ ≈150 mil palabras 200 mil
GLM 5.3 Z.ai 1,40 US$ 4,40 US$ ≈170,5 mil palabras 1,3 M
Grok 4.6 xAI 2,00 US$ 6,00 US$ ≈125 mil palabras 500 mil
GPT-5.6 Sol OpenAI 2,00 US$ 10,00 US$ ≈75 mil palabras 1,1 M
Claude Sonnet 5 Anthropic 2,00 US$ 10,00 US$ ≈75 mil palabras 1 M
GPT-5.6 Terra OpenAI 2,00 US$ 12,00 US$ ≈62,5 mil palabras 1,1 M
Gemini 3.1 Pro Preview Google 2,00 US$ 12,00 US$ ≈62,5 mil palabras 1 M
Kimi K3 Moonshot 2,648 US$ 13,283 US$ ≈56,5 mil palabras 1 M
Claude Opus 5 Anthropic 5,00 US$ 25,00 US$ ≈30 mil palabras 1 M
GPT-6 Astra OpenAI 10,00 US$ 50,00 US$ ≈15 mil palabras 1,1 M
Claude Fable 5.1 Anthropic 10,00 US$ 50,00 US$ ≈15 mil palabras 1 M

Dólares por millón de tokens, entrada y salida. lista pública de modelos de OpenRouter, comprobada el 15 de septiembre de 2026. Son precios de lista; confirma en la página de precios del fabricante antes de presupuestar, y ten en cuenta que los modos de razonamiento cobran su pensamiento como salida.

Nuevo este mes

Modelos de fabricantes conocidos listados en los últimos 30 días, los más recientes primero.

ListadoModeloFabricante$/M entrada / salida
hace 5 días10 sept 2026 DeepSeek V4.1 Flash DeepSeek 0,15 US$ / 0,60 US$
hace 11 días4 sept 2026 GPT-6 Astra OpenAI 10,00 US$ / 50,00 US$
hace 11 días4 sept 2026 GPT-6 Astra Pro OpenAI 10,00 US$ / 50,00 US$
hace 12 días3 sept 2026 Qwen3.8 Max (0902) Alibaba 2,00 US$ / 6,00 US$
hace 13 días2 sept 2026 Muse Spark 1.3 Contributor Meta 0,10 US$ / 0,20 US$
hace 13 días2 sept 2026 Muse Spark 1.3 Meta 1,25 US$ / 4,25 US$
hace 13 días2 sept 2026 Gemini 3.8 Flash Google 0,75 US$ / 3,75 US$
hace 14 días1 sept 2026 Claude Fable 5.1 Anthropic 10,00 US$ / 50,00 US$
hace 15 días31 ago 2026 Granite 4.2 8B IBM 0,06 US$ / 0,25 US$
hace 18 días28 ago 2026 Hy4 preview Tencent 0,834 US$ / 2,501 US$
hace 20 días26 ago 2026 Qwen3.8 Flash Alibaba 0,15 US$ / 0,47 US$
hace 20 días26 ago 2026 GLM 5.3 Flash Z.ai 0,075 US$ / 0,25 US$
hace 25 días21 ago 2026 Muse Spark 1.2 Contributor Meta 0,10 US$ / 0,20 US$
hace 25 días21 ago 2026 DeepSeek V4 Flash Vision Exp DeepSeek 0,22 US$ / 0,66 US$
hace 26 días20 ago 2026 Hy-MT2-1.8B Tencent 0,044 US$ / 0,177 US$
hace 26 días20 ago 2026 Hy-MT2-30B-A3B Tencent 0,074 US$ / 0,295 US$
hace 27 días19 ago 2026 Hy-MT2-7B Tencent 0,074 US$ / 0,295 US$
hace 28 días18 ago 2026 GLM 5.3 Z.ai 1,40 US$ / 4,40 US$

Listados de los últimos 30 días de grandes fabricantes, comprobados el 15 de septiembre de 2026. Fuente: lista de modelos de OpenRouter.

Cómo funciona el ranking

LMArena (la antigua Chatbot Arena del grupo LMSYS de UC Berkeley) muestra a cada visitante dos modelos anónimos respondiendo a la misma pregunta y le pide que elija la mejor respuesta. Millones de esos votos alimentan una valoración Bradley-Terry, la misma familia matemática que el Elo del ajedrez, de modo que la puntuación de un modelo indica con qué frecuencia gana frente al resto. El margen del 95 % junto a cada puntuación es la incertidumbre: un modelo con 5.000 votos tiene un margen más ancho que uno con 70.000. Mostramos la tabla general de texto por defecto de LMArena, una fila por modelo. LMArena lista el mismo modelo varias veces con distintos ajustes de razonamiento («high», «max»); nos quedamos con el mejor clasificado e indicamos el ajuste entre paréntesis.

Cómo leer los precios

Las empresas de IA cobran por token, y un token equivale a unas tres cuartas partes de una palabra en inglés, así que un millón de tokens son unas 750.000 palabras. La entrada es lo que envías (tu pregunta, el documento que pegas); la salida es lo que el modelo escribe. La salida es la parte cara, y los modos de «pensamiento» o razonamiento cobran también su razonamiento oculto como salida, así que una pregunta difícil puede costar varias veces lo que sugiere la longitud de la respuesta. Los precios de aquí son los de lista del catálogo público de OpenRouter, que reflejan las tarifas de los propios fabricantes; OpenAI, Anthropic y Google venden además tarifas por lotes a mitad de precio para trabajos que pueden esperar. Confirma siempre en la página de precios del fabricante antes de presupuestar.

Advertisement

¿Cuál deberías usar en realidad?

Si usas la IA desde una app de chat y no desde una API, el ranking importa menos de lo que parece. Los diez primeros están a pocos puntos entre sí, las versiones gratuitas de ChatGPT, Claude y Gemini funcionan con modelos de ese grupo, y las diferencias que cuentan en el día a día son las funciones de la app: memoria, manejo de archivos, voz y si tu empresa la permite. Elige por la app que te guste y el precio que pagues. Si pagas por token, la tabla de costes es la que debes leer: entre el modelo de marca más barato y el más caro hay más de cien veces de diferencia, y para el trabajo rutinario el extremo barato suele bastar.

Lo que esta página no te dice

Un voto cara a cara mide qué respuesta prefirió la gente en una ventana de chat. No mide la precisión al programar, el trabajo con documentos largos, la comprensión de imágenes, la velocidad ni cómo se comporta un modelo dentro de un agente. LMArena mantiene tablas separadas para varias de esas cosas, y conjuntos de pruebas como Artificial Analysis publican sus propios índices. Toma esta tabla como el voto popular, no como la elección entera.

Preguntas frecuentes

¿Cuál es el mejor modelo de IA ahora mismo?

Según los votos a ciegas de LMArena, el modelo que encabeza la tabla de esta página. Mira la columna del margen: cuando los primeros se solapan, están empatados a efectos prácticos y el orden puede cambiar de una semana a otra.

¿Cada cuánto se actualiza esta página?

Una vez al día. LMArena publica nuevas instantáneas de la tabla cada pocos días y la lista de precios de OpenRouter cambia cuando un fabricante modifica un precio o lista un modelo; la mesa recoge ambas cosas en su siguiente pasada diaria y marca bajo cada tabla la fecha de la última comprobación.

¿Qué significa «pesos abiertos»?

Que el fabricante ha publicado los pesos del modelo con una licencia que te permite descargarlo y ejecutarlo tú mismo, en tu propio hardware o en una nube que alquiles, en lugar de solo a través de su API. Los modelos propietarios solo pueden usarse a través de la empresa que los creó.

¿Por qué un modelo aparece dos veces en LMArena y una aquí?

LMArena puntúa el mismo modelo con distintos ajustes de razonamiento como filas separadas. Nos quedamos con el ajuste mejor clasificado de cada modelo para que la tabla se lea como una lista de modelos, y mostramos el ajuste entre paréntesis tras el nombre.

¿Basta con el modelo más barato?

Para la mayor parte de la escritura, los resúmenes y las respuestas cotidianas, sí: la gama barata de un gran fabricante suele ser una versión reducida de su modelo estrella. Paga la gama cara cuando necesites razonamientos largos y cuidadosos, código complejo o la mejor respuesta posible a la primera.

Sigue leyendo

Datos del ranking: LMArena. Datos de precios y listados: OpenRouter. Ambos aparecen acreditados en cada tabla; este sitio no está afiliado a ninguno.

Advertisement