Mesa en vivo, actualizada a diario
Ranking de modelos de IA: quién es el n.º 1 ahora mismo
La tabla que la gente cita de verdad, el precio de cada modelo y los lanzamientos del mes, en una página que se actualiza sola.
A 13 de septiembre de 2026, Claude Fable 5.1 (max) de Anthropic lidera la tabla de texto de LMArena, con Claude Opus 5 (max) y Claude Opus 4.6 (high) muy cerca.
Entre los modelos de marca, GLM 5.3 Flash es el más barato de usar, a 0,25 US$ por millón de tokens de salida, y Claude Fable 5.1 el más caro, a 50,00 US$.
La cabeza de la tabla suele ser un empate estadístico: cuando los márgenes de dos modelos se solapan, los votos no pueden separarlos.
La tabla
La tabla de texto de LMArena: la gente chatea con dos modelos anónimos a la vez y vota la mejor respuesta. Una fila por modelo; los niveles de razonamiento se agrupan en el mejor.
| # | Modelo | Fabricante | Puntuación | Votos |
|---|---|---|---|---|
| 1 | Claude Fable 5.1 (max) | Anthropic | 1508 ±9 | 5783 |
| 2 | Claude Opus 5 (max) | Anthropic | 1505 ±5 | 20.706 |
| 3 | Claude Opus 4.6 (high) | Anthropic | 1503 ±4 | 71.993 |
| 4 | Gemini 3.8 Flash (high) | 1495 ±9 | 5076 | |
| 5 | Claude Fable 5 | Anthropic | 1493 ±5 | 30.057 |
| 6 | Gemini 3.7 Flash (high) | 1490 ±9 | 5640 | |
| 7 | Claude Opus 4.7 (high) | Anthropic | 1490 ±4 | 60.002 |
| 8 | Muse Spark 1.3 (max) | Meta | 1490 ±9 | 4723 |
| 9 | Muse Spark 1.2 (xhigh) | Meta | 1489 ±11 | 3227 |
| 10 | Gemini 3.5 Flash (high) | 1482 ±4 | 38.257 | |
| 11 | Qwen3.8 (max) | Alibaba | 1481 ±6 | 16.670 |
| 12 | Muse Spark 1.1 | Meta | 1480 ±5 | 27.615 |
| 13 | Gemini 3.1 Pro Preview | 1480 ±3 | 106.951 | |
| 14 | Gemini 3 Pro | 1479 ±4 | 40.654 | |
| 15 | Gemini 3.6 Flash (high) | 1476 ±5 | 26.445 | |
| 16 | GLM 5.3 (max)Pesos abiertos | Z.ai | 1475 ±6 | 10.960 |
| 17 | Qwen3.7 Max Preview | Alibaba | 1474 ±10 | 3705 |
| 18 | Muse Spark | Meta | 1473 ±6 | 13.565 |
| 19 | Kimi K3 (max)Pesos abiertos | Moonshot | 1472 ±5 | 20.987 |
| 20 | GLM 5.3 FlashPesos abiertos | Z.ai | 1472 ±7 | 10.038 |
| 21 | Qwen3.5 Max Preview | Alibaba | 1471 ±5 | 21.476 |
| 22 | GPT-5.5 (high) | OpenAI | 1471 ±4 | 64.924 |
| 23 | GPT-5.4 (high) | OpenAI | 1470 ±4 | 60.537 |
| 24 | ERNIE 5.1 | Baidu | 1468 ±5 | 37.058 |
| 25 | GLM 5.2 (max)Pesos abiertos | Z.ai | 1467 ±5 | 36.798 |
Tabla de texto de LMArena, publicada el 13 de septiembre de 2026. La puntuación es la valoración de la arena con su margen del 95 %; las filas cuyos márgenes se solapan están empatadas estadísticamente.
Mejores modelos de pesos abiertos
Los mismos votos de LMArena, solo modelos cuyos pesos puedes descargar y ejecutar tú mismo. El número gris es su puesto en la tabla general.
| # | Modelo | Fabricante | Puntuación | Votos |
|---|---|---|---|---|
| 1 | GLM 5.3 (max)n.º 20 general | Z.ai | 1475 ±6 | 10.960 |
| 2 | Kimi K3 (max)n.º 23 general | Moonshot | 1472 ±5 | 20.987 |
| 3 | GLM 5.3 Flashn.º 24 general | Z.ai | 1472 ±7 | 10.038 |
| 4 | GLM 5.2 (max)n.º 29 general | Z.ai | 1467 ±5 | 36.798 |
| 5 | Mimo V2.5 Pron.º 32 general | Xiaomi | 1465 ±4 | 60.919 |
| 6 | GLM 5.1n.º 33 general | Z.ai | 1462 ±4 | 48.901 |
| 7 | Kimi K2.6n.º 38 general | Moonshot | 1455 ±5 | 37.502 |
| 8 | DeepSeek V4 Pron.º 43 general | DeepSeek | 1451 ±4 | 54.130 |
| 9 | GLM 5n.º 51 general | Z.ai | 1446 ±5 | 27.605 |
| 10 | Kimi K2.5 (thinking)n.º 53 general | Moonshot | 1446 ±4 | 70.513 |
| 11 | DeepSeek V4 Pro High Previewn.º 54 general | DeepSeek | 1445 ±4 | 51.485 |
| 12 | Nvidia Nemotron 3 Ultra 550b A55B Nvfp4n.º 55 general | Nvidia | 1445 ±7 | 10.693 |
| 13 | DeepSeek V4 Pro High 20260813n.º 58 general | DeepSeek | 1444 ±7 | 9008 |
| 14 | Gemma 4 31bn.º 64 general | 1442 ±8 | 5894 | |
| 15 | Hy3n.º 65 general | Tencent | 1441 ±8 | 8047 |
Tabla de texto de LMArena, publicada el 13 de septiembre de 2026. La puntuación es la valoración de la arena con su margen del 95 %; las filas cuyos márgenes se solapan están empatadas estadísticamente.
Cuánto cuesta cada modelo
Precio de lista por millón de tokens del modelo actual de cada familia, del más barato al más caro. Un millón de tokens son unas 750.000 palabras de texto, de entrada o de salida.
| Modelo | Fabricante | Entrada | Salida | 1 $ compra | Contexto |
|---|---|---|---|---|---|
| GLM 5.3 Flash | Z.ai | 0,075 US$ | 0,25 US$ | ≈3 M palabras | 1,3 M |
| DeepSeek V4.1 Flash | DeepSeek | 0,15 US$ | 0,60 US$ | ≈1,3 M palabras | 1 M |
| GPT-5.6 Luna | OpenAI | 0,20 US$ | 1,20 US$ | ≈625 mil palabras | 1,1 M |
| DeepSeek V4 Pro 0813 | DeepSeek | 0,66 US$ | 1,98 US$ | ≈378,8 mil palabras | 1 M |
| Gemini 3.8 Flash | 0,75 US$ | 3,75 US$ | ≈200 mil palabras | 1 M | |
| GPT-5.4 Mini | OpenAI | 0,75 US$ | 4,50 US$ | ≈166,7 mil palabras | 400 mil |
| Claude Haiku 4.5 | Anthropic | 1,00 US$ | 5,00 US$ | ≈150 mil palabras | 200 mil |
| GLM 5.3 | Z.ai | 1,40 US$ | 4,40 US$ | ≈170,5 mil palabras | 1,3 M |
| Grok 4.6 | xAI | 2,00 US$ | 6,00 US$ | ≈125 mil palabras | 500 mil |
| GPT-5.6 Sol | OpenAI | 2,00 US$ | 10,00 US$ | ≈75 mil palabras | 1,1 M |
| Claude Sonnet 5 | Anthropic | 2,00 US$ | 10,00 US$ | ≈75 mil palabras | 1 M |
| GPT-5.6 Terra | OpenAI | 2,00 US$ | 12,00 US$ | ≈62,5 mil palabras | 1,1 M |
| Gemini 3.1 Pro Preview | 2,00 US$ | 12,00 US$ | ≈62,5 mil palabras | 1 M | |
| Kimi K3 | Moonshot | 2,648 US$ | 13,283 US$ | ≈56,5 mil palabras | 1 M |
| Claude Opus 5 | Anthropic | 5,00 US$ | 25,00 US$ | ≈30 mil palabras | 1 M |
| GPT-6 Astra | OpenAI | 10,00 US$ | 50,00 US$ | ≈15 mil palabras | 1,1 M |
| Claude Fable 5.1 | Anthropic | 10,00 US$ | 50,00 US$ | ≈15 mil palabras | 1 M |
Dólares por millón de tokens, entrada y salida. lista pública de modelos de OpenRouter, comprobada el 15 de septiembre de 2026. Son precios de lista; confirma en la página de precios del fabricante antes de presupuestar, y ten en cuenta que los modos de razonamiento cobran su pensamiento como salida.
Nuevo este mes
Modelos de fabricantes conocidos listados en los últimos 30 días, los más recientes primero.
| Listado | Modelo | Fabricante | $/M entrada / salida |
|---|---|---|---|
| hace 5 días10 sept 2026 | DeepSeek V4.1 Flash | DeepSeek | 0,15 US$ / 0,60 US$ |
| hace 11 días4 sept 2026 | GPT-6 Astra | OpenAI | 10,00 US$ / 50,00 US$ |
| hace 11 días4 sept 2026 | GPT-6 Astra Pro | OpenAI | 10,00 US$ / 50,00 US$ |
| hace 12 días3 sept 2026 | Qwen3.8 Max (0902) | Alibaba | 2,00 US$ / 6,00 US$ |
| hace 13 días2 sept 2026 | Muse Spark 1.3 Contributor | Meta | 0,10 US$ / 0,20 US$ |
| hace 13 días2 sept 2026 | Muse Spark 1.3 | Meta | 1,25 US$ / 4,25 US$ |
| hace 13 días2 sept 2026 | Gemini 3.8 Flash | 0,75 US$ / 3,75 US$ | |
| hace 14 días1 sept 2026 | Claude Fable 5.1 | Anthropic | 10,00 US$ / 50,00 US$ |
| hace 15 días31 ago 2026 | Granite 4.2 8B | IBM | 0,06 US$ / 0,25 US$ |
| hace 18 días28 ago 2026 | Hy4 preview | Tencent | 0,834 US$ / 2,501 US$ |
| hace 20 días26 ago 2026 | Qwen3.8 Flash | Alibaba | 0,15 US$ / 0,47 US$ |
| hace 20 días26 ago 2026 | GLM 5.3 Flash | Z.ai | 0,075 US$ / 0,25 US$ |
| hace 25 días21 ago 2026 | Muse Spark 1.2 Contributor | Meta | 0,10 US$ / 0,20 US$ |
| hace 25 días21 ago 2026 | DeepSeek V4 Flash Vision Exp | DeepSeek | 0,22 US$ / 0,66 US$ |
| hace 26 días20 ago 2026 | Hy-MT2-1.8B | Tencent | 0,044 US$ / 0,177 US$ |
| hace 26 días20 ago 2026 | Hy-MT2-30B-A3B | Tencent | 0,074 US$ / 0,295 US$ |
| hace 27 días19 ago 2026 | Hy-MT2-7B | Tencent | 0,074 US$ / 0,295 US$ |
| hace 28 días18 ago 2026 | GLM 5.3 | Z.ai | 1,40 US$ / 4,40 US$ |
Sin modelos nuevos de grandes fabricantes en los últimos 30 días.
Listados de los últimos 30 días de grandes fabricantes, comprobados el 15 de septiembre de 2026. Fuente: lista de modelos de OpenRouter.
Cómo funciona el ranking
LMArena (la antigua Chatbot Arena del grupo LMSYS de UC Berkeley) muestra a cada visitante dos modelos anónimos respondiendo a la misma pregunta y le pide que elija la mejor respuesta. Millones de esos votos alimentan una valoración Bradley-Terry, la misma familia matemática que el Elo del ajedrez, de modo que la puntuación de un modelo indica con qué frecuencia gana frente al resto. El margen del 95 % junto a cada puntuación es la incertidumbre: un modelo con 5.000 votos tiene un margen más ancho que uno con 70.000. Mostramos la tabla general de texto por defecto de LMArena, una fila por modelo. LMArena lista el mismo modelo varias veces con distintos ajustes de razonamiento («high», «max»); nos quedamos con el mejor clasificado e indicamos el ajuste entre paréntesis.
Cómo leer los precios
Las empresas de IA cobran por token, y un token equivale a unas tres cuartas partes de una palabra en inglés, así que un millón de tokens son unas 750.000 palabras. La entrada es lo que envías (tu pregunta, el documento que pegas); la salida es lo que el modelo escribe. La salida es la parte cara, y los modos de «pensamiento» o razonamiento cobran también su razonamiento oculto como salida, así que una pregunta difícil puede costar varias veces lo que sugiere la longitud de la respuesta. Los precios de aquí son los de lista del catálogo público de OpenRouter, que reflejan las tarifas de los propios fabricantes; OpenAI, Anthropic y Google venden además tarifas por lotes a mitad de precio para trabajos que pueden esperar. Confirma siempre en la página de precios del fabricante antes de presupuestar.
¿Cuál deberías usar en realidad?
Si usas la IA desde una app de chat y no desde una API, el ranking importa menos de lo que parece. Los diez primeros están a pocos puntos entre sí, las versiones gratuitas de ChatGPT, Claude y Gemini funcionan con modelos de ese grupo, y las diferencias que cuentan en el día a día son las funciones de la app: memoria, manejo de archivos, voz y si tu empresa la permite. Elige por la app que te guste y el precio que pagues. Si pagas por token, la tabla de costes es la que debes leer: entre el modelo de marca más barato y el más caro hay más de cien veces de diferencia, y para el trabajo rutinario el extremo barato suele bastar.
Lo que esta página no te dice
Un voto cara a cara mide qué respuesta prefirió la gente en una ventana de chat. No mide la precisión al programar, el trabajo con documentos largos, la comprensión de imágenes, la velocidad ni cómo se comporta un modelo dentro de un agente. LMArena mantiene tablas separadas para varias de esas cosas, y conjuntos de pruebas como Artificial Analysis publican sus propios índices. Toma esta tabla como el voto popular, no como la elección entera.
Preguntas frecuentes
¿Cuál es el mejor modelo de IA ahora mismo?
Según los votos a ciegas de LMArena, el modelo que encabeza la tabla de esta página. Mira la columna del margen: cuando los primeros se solapan, están empatados a efectos prácticos y el orden puede cambiar de una semana a otra.
¿Cada cuánto se actualiza esta página?
Una vez al día. LMArena publica nuevas instantáneas de la tabla cada pocos días y la lista de precios de OpenRouter cambia cuando un fabricante modifica un precio o lista un modelo; la mesa recoge ambas cosas en su siguiente pasada diaria y marca bajo cada tabla la fecha de la última comprobación.
¿Qué significa «pesos abiertos»?
Que el fabricante ha publicado los pesos del modelo con una licencia que te permite descargarlo y ejecutarlo tú mismo, en tu propio hardware o en una nube que alquiles, en lugar de solo a través de su API. Los modelos propietarios solo pueden usarse a través de la empresa que los creó.
¿Por qué un modelo aparece dos veces en LMArena y una aquí?
LMArena puntúa el mismo modelo con distintos ajustes de razonamiento como filas separadas. Nos quedamos con el ajuste mejor clasificado de cada modelo para que la tabla se lea como una lista de modelos, y mostramos el ajuste entre paréntesis tras el nombre.
¿Basta con el modelo más barato?
Para la mayor parte de la escritura, los resúmenes y las respuestas cotidianas, sí: la gama barata de un gran fabricante suele ser una versión reducida de su modelo estrella. Paga la gama cara cuando necesites razonamientos largos y cuidadosos, código complejo o la mejor respuesta posible a la primera.
Sigue leyendo
- GPT-6 Astra ya está aquí: qué cambió
- Claude Fable 5.1: el modelo que caza errores
- Por qué todas las IA suenan igual
- Por qué Opus 4.6 acabó con la era del copiloto
- Modelos de razonamiento explicados: IA que piensa antes de hablar
Datos del ranking: LMArena. Datos de precios y listados: OpenRouter. Ambos aparecen acreditados en cada tabla; este sitio no está afiliado a ninguno.