Mesa ao vivo, atualizada diariamente
Ranking de modelos de IA: quem é o nº 1 agora
O placar que as pessoas realmente citam, o preço de cada modelo e os lançamentos do mês, em uma página que se atualiza sozinha.
Em 13 de setembro de 2026, Claude Fable 5.1 (max) da Anthropic lidera o placar de texto da LMArena, com Claude Opus 5 (max) e Claude Opus 4.6 (high) logo atrás.
Entre os modelos de marca, GLM 5.3 Flash é o mais barato de usar, a US$ 0,25 por milhão de tokens de saída, e Claude Fable 5.1 o mais caro, a US$ 50,00.
O topo da tabela costuma ser um empate estatístico: quando as margens de dois modelos se sobrepõem, os votos não conseguem separá-los.
O placar
O placar de texto da LMArena: as pessoas conversam com dois modelos anônimos lado a lado e votam na melhor resposta. Uma linha por modelo; os níveis de raciocínio são agrupados no melhor.
| # | Modelo | Fabricante | Pontuação | Votos |
|---|---|---|---|---|
| 1 | Claude Fable 5.1 (max) | Anthropic | 1.508 ±9 | 5.783 |
| 2 | Claude Opus 5 (max) | Anthropic | 1.505 ±5 | 20.706 |
| 3 | Claude Opus 4.6 (high) | Anthropic | 1.503 ±4 | 71.993 |
| 4 | Gemini 3.8 Flash (high) | 1.495 ±9 | 5.076 | |
| 5 | Claude Fable 5 | Anthropic | 1.493 ±5 | 30.057 |
| 6 | Gemini 3.7 Flash (high) | 1.490 ±9 | 5.640 | |
| 7 | Claude Opus 4.7 (high) | Anthropic | 1.490 ±4 | 60.002 |
| 8 | Muse Spark 1.3 (max) | Meta | 1.490 ±9 | 4.723 |
| 9 | Muse Spark 1.2 (xhigh) | Meta | 1.489 ±11 | 3.227 |
| 10 | Gemini 3.5 Flash (high) | 1.482 ±4 | 38.257 | |
| 11 | Qwen3.8 (max) | Alibaba | 1.481 ±6 | 16.670 |
| 12 | Muse Spark 1.1 | Meta | 1.480 ±5 | 27.615 |
| 13 | Gemini 3.1 Pro Preview | 1.480 ±3 | 106.951 | |
| 14 | Gemini 3 Pro | 1.479 ±4 | 40.654 | |
| 15 | Gemini 3.6 Flash (high) | 1.476 ±5 | 26.445 | |
| 16 | GLM 5.3 (max)Pesos abertos | Z.ai | 1.475 ±6 | 10.960 |
| 17 | Qwen3.7 Max Preview | Alibaba | 1.474 ±10 | 3.705 |
| 18 | Muse Spark | Meta | 1.473 ±6 | 13.565 |
| 19 | Kimi K3 (max)Pesos abertos | Moonshot | 1.472 ±5 | 20.987 |
| 20 | GLM 5.3 FlashPesos abertos | Z.ai | 1.472 ±7 | 10.038 |
| 21 | Qwen3.5 Max Preview | Alibaba | 1.471 ±5 | 21.476 |
| 22 | GPT-5.5 (high) | OpenAI | 1.471 ±4 | 64.924 |
| 23 | GPT-5.4 (high) | OpenAI | 1.470 ±4 | 60.537 |
| 24 | ERNIE 5.1 | Baidu | 1.468 ±5 | 37.058 |
| 25 | GLM 5.2 (max)Pesos abertos | Z.ai | 1.467 ±5 | 36.798 |
Placar de texto da LMArena, publicado em 13 de setembro de 2026. A pontuação é a nota da arena com sua margem de 95%; linhas com margens sobrepostas estão empatadas estatisticamente.
Melhores modelos de pesos abertos
Os mesmos votos da LMArena, só os modelos cujos pesos você pode baixar e rodar por conta própria. O número cinza é a posição de cada um no placar geral.
| # | Modelo | Fabricante | Pontuação | Votos |
|---|---|---|---|---|
| 1 | GLM 5.3 (max)nº 20 no geral | Z.ai | 1.475 ±6 | 10.960 |
| 2 | Kimi K3 (max)nº 23 no geral | Moonshot | 1.472 ±5 | 20.987 |
| 3 | GLM 5.3 Flashnº 24 no geral | Z.ai | 1.472 ±7 | 10.038 |
| 4 | GLM 5.2 (max)nº 29 no geral | Z.ai | 1.467 ±5 | 36.798 |
| 5 | Mimo V2.5 Pronº 32 no geral | Xiaomi | 1.465 ±4 | 60.919 |
| 6 | GLM 5.1nº 33 no geral | Z.ai | 1.462 ±4 | 48.901 |
| 7 | Kimi K2.6nº 38 no geral | Moonshot | 1.455 ±5 | 37.502 |
| 8 | DeepSeek V4 Pronº 43 no geral | DeepSeek | 1.451 ±4 | 54.130 |
| 9 | GLM 5nº 51 no geral | Z.ai | 1.446 ±5 | 27.605 |
| 10 | Kimi K2.5 (thinking)nº 53 no geral | Moonshot | 1.446 ±4 | 70.513 |
| 11 | DeepSeek V4 Pro High Previewnº 54 no geral | DeepSeek | 1.445 ±4 | 51.485 |
| 12 | Nvidia Nemotron 3 Ultra 550b A55B Nvfp4nº 55 no geral | Nvidia | 1.445 ±7 | 10.693 |
| 13 | DeepSeek V4 Pro High 20260813nº 58 no geral | DeepSeek | 1.444 ±7 | 9.008 |
| 14 | Gemma 4 31bnº 64 no geral | 1.442 ±8 | 5.894 | |
| 15 | Hy3nº 65 no geral | Tencent | 1.441 ±8 | 8.047 |
Placar de texto da LMArena, publicado em 13 de setembro de 2026. A pontuação é a nota da arena com sua margem de 95%; linhas com margens sobrepostas estão empatadas estatisticamente.
Quanto custa cada modelo
Preço de tabela por milhão de tokens do modelo atual de cada família, do mais barato ao mais caro. Um milhão de tokens equivale a cerca de 750 mil palavras de texto, de entrada ou de saída.
| Modelo | Fabricante | Entrada | Saída | US$ 1 compra | Contexto |
|---|---|---|---|---|---|
| GLM 5.3 Flash | Z.ai | US$ 0,075 | US$ 0,25 | ≈3 mi palavras | 1,3 mi |
| DeepSeek V4.1 Flash | DeepSeek | US$ 0,15 | US$ 0,60 | ≈1,3 mi palavras | 1 mi |
| GPT-5.6 Luna | OpenAI | US$ 0,20 | US$ 1,20 | ≈625 mil palavras | 1,1 mi |
| DeepSeek V4 Pro 0813 | DeepSeek | US$ 0,66 | US$ 1,98 | ≈378,8 mil palavras | 1 mi |
| Gemini 3.8 Flash | US$ 0,75 | US$ 3,75 | ≈200 mil palavras | 1 mi | |
| GPT-5.4 Mini | OpenAI | US$ 0,75 | US$ 4,50 | ≈166,7 mil palavras | 400 mil |
| Claude Haiku 4.5 | Anthropic | US$ 1,00 | US$ 5,00 | ≈150 mil palavras | 200 mil |
| GLM 5.3 | Z.ai | US$ 1,40 | US$ 4,40 | ≈170,5 mil palavras | 1,3 mi |
| Grok 4.6 | xAI | US$ 2,00 | US$ 6,00 | ≈125 mil palavras | 500 mil |
| GPT-5.6 Sol | OpenAI | US$ 2,00 | US$ 10,00 | ≈75 mil palavras | 1,1 mi |
| Claude Sonnet 5 | Anthropic | US$ 2,00 | US$ 10,00 | ≈75 mil palavras | 1 mi |
| GPT-5.6 Terra | OpenAI | US$ 2,00 | US$ 12,00 | ≈62,5 mil palavras | 1,1 mi |
| Gemini 3.1 Pro Preview | US$ 2,00 | US$ 12,00 | ≈62,5 mil palavras | 1 mi | |
| Kimi K3 | Moonshot | US$ 2,648 | US$ 13,283 | ≈56,5 mil palavras | 1 mi |
| Claude Opus 5 | Anthropic | US$ 5,00 | US$ 25,00 | ≈30 mil palavras | 1 mi |
| GPT-6 Astra | OpenAI | US$ 10,00 | US$ 50,00 | ≈15 mil palavras | 1,1 mi |
| Claude Fable 5.1 | Anthropic | US$ 10,00 | US$ 50,00 | ≈15 mil palavras | 1 mi |
Dólares por milhão de tokens, entrada e saída. lista pública de modelos da OpenRouter, verificada em 15 de setembro de 2026. São preços de tabela; confirme na página de preços do fabricante antes de orçar, e lembre que os modos de raciocínio cobram o pensamento como saída.
Novo este mês
Modelos de fabricantes conhecidos listados nos últimos 30 dias, os mais recentes primeiro.
| Listado | Modelo | Fabricante | $/M entrada / saída |
|---|---|---|---|
| há 5 dias10 de set. de 2026 | DeepSeek V4.1 Flash | DeepSeek | US$ 0,15 / US$ 0,60 |
| há 11 dias4 de set. de 2026 | GPT-6 Astra | OpenAI | US$ 10,00 / US$ 50,00 |
| há 11 dias4 de set. de 2026 | GPT-6 Astra Pro | OpenAI | US$ 10,00 / US$ 50,00 |
| há 12 dias3 de set. de 2026 | Qwen3.8 Max (0902) | Alibaba | US$ 2,00 / US$ 6,00 |
| há 13 dias2 de set. de 2026 | Muse Spark 1.3 Contributor | Meta | US$ 0,10 / US$ 0,20 |
| há 13 dias2 de set. de 2026 | Muse Spark 1.3 | Meta | US$ 1,25 / US$ 4,25 |
| há 13 dias2 de set. de 2026 | Gemini 3.8 Flash | US$ 0,75 / US$ 3,75 | |
| há 14 dias1 de set. de 2026 | Claude Fable 5.1 | Anthropic | US$ 10,00 / US$ 50,00 |
| há 15 dias31 de ago. de 2026 | Granite 4.2 8B | IBM | US$ 0,06 / US$ 0,25 |
| há 18 dias28 de ago. de 2026 | Hy4 preview | Tencent | US$ 0,834 / US$ 2,501 |
| há 20 dias26 de ago. de 2026 | Qwen3.8 Flash | Alibaba | US$ 0,15 / US$ 0,47 |
| há 20 dias26 de ago. de 2026 | GLM 5.3 Flash | Z.ai | US$ 0,075 / US$ 0,25 |
| há 25 dias21 de ago. de 2026 | Muse Spark 1.2 Contributor | Meta | US$ 0,10 / US$ 0,20 |
| há 25 dias21 de ago. de 2026 | DeepSeek V4 Flash Vision Exp | DeepSeek | US$ 0,22 / US$ 0,66 |
| há 26 dias20 de ago. de 2026 | Hy-MT2-1.8B | Tencent | US$ 0,044 / US$ 0,177 |
| há 26 dias20 de ago. de 2026 | Hy-MT2-30B-A3B | Tencent | US$ 0,074 / US$ 0,295 |
| há 27 dias19 de ago. de 2026 | Hy-MT2-7B | Tencent | US$ 0,074 / US$ 0,295 |
| há 28 dias18 de ago. de 2026 | GLM 5.3 | Z.ai | US$ 1,40 / US$ 4,40 |
Nenhum modelo novo de grandes fabricantes nos últimos 30 dias.
Listagens dos últimos 30 dias de grandes fabricantes, verificadas em 15 de setembro de 2026. Fonte: lista de modelos da OpenRouter.
Como o ranking funciona
A LMArena (a antiga Chatbot Arena do grupo LMSYS da UC Berkeley) mostra ao visitante dois modelos anônimos respondendo à mesma pergunta e pede que escolha a melhor resposta. Milhões desses votos alimentam uma nota Bradley-Terry, a mesma família matemática do Elo do xadrez, de modo que a pontuação de um modelo indica com que frequência ele vence os demais. A margem de 95% ao lado de cada pontuação é a incerteza: um modelo com 5 mil votos tem margem mais larga do que um com 70 mil. Mostramos o placar geral de texto padrão da LMArena, uma linha por modelo. A LMArena lista o mesmo modelo várias vezes com diferentes configurações de raciocínio ("high", "max"); mantemos a mais bem classificada e indicamos a configuração entre parênteses.
Como ler os preços
As empresas de IA cobram por token, e um token equivale a cerca de três quartos de uma palavra em inglês, então um milhão de tokens são aproximadamente 750 mil palavras. Entrada é o que você envia (sua pergunta, o documento colado); saída é o que o modelo escreve de volta. A saída é o lado caro, e os modos de "pensamento" ou raciocínio cobram o raciocínio oculto também como saída, então uma pergunta difícil pode custar várias vezes o que o tamanho da resposta sugere. Os preços aqui são os de tabela do catálogo público da OpenRouter, que espelham as tarifas dos próprios fabricantes; OpenAI, Anthropic e Google também vendem tarifas em lote pela metade do preço para trabalhos que podem esperar. Confirme sempre na página de preços do fabricante antes de orçar.
Qual você deveria usar de fato?
Se você usa IA por um app de chat e não por uma API, o ranking importa menos do que parece. Os dez primeiros estão a poucos pontos uns dos outros, as versões gratuitas de ChatGPT, Claude e Gemini rodam modelos desse grupo, e as diferenças que pesam no dia a dia são os recursos do app: memória, arquivos, voz e se a sua empresa permite. Escolha pelo app de que você gosta e pelo preço que paga. Se você paga por token, a tabela de custos é a que deve ler: a distância entre o modelo de marca mais barato e o mais caro passa de cem vezes, e para o trabalho rotineiro a ponta barata costuma bastar.
O que esta página não diz
Um voto cara a cara mede qual resposta as pessoas preferiram numa janela de chat. Não mede precisão em código, trabalho com documentos longos, compreensão de imagens, velocidade ou como um modelo se comporta dentro de um agente. A LMArena mantém placares separados para vários desses pontos, e conjuntos de benchmarks como o Artificial Analysis publicam índices próprios. Trate esta tabela como o voto popular, não como a eleição inteira.
Perguntas frequentes
Qual é o melhor modelo de IA agora?
Pelos votos às cegas da LMArena, o modelo no topo da tabela desta página. Veja a coluna da margem: quando os primeiros se sobrepõem, estão empatados na prática, e a ordem pode trocar de uma semana para a outra.
Com que frequência esta página é atualizada?
Uma vez por dia. A LMArena publica novos retratos do placar a cada poucos dias e a lista de preços da OpenRouter muda sempre que um fabricante altera um preço ou lista um modelo; a mesa capta as duas coisas na próxima rodada diária e registra sob cada tabela a data da última verificação.
O que significa "pesos abertos"?
O fabricante publicou os pesos do modelo sob uma licença que permite baixá-lo e executá-lo por conta própria, no seu hardware ou numa nuvem alugada, em vez de apenas pela API do fabricante. Modelos proprietários só podem ser usados pela empresa que os criou.
Por que um modelo aparece duas vezes na LMArena e uma vez aqui?
A LMArena pontua o mesmo modelo em diferentes configurações de raciocínio como linhas separadas. Mantemos a configuração mais bem classificada de cada modelo para que a tabela se leia como uma lista de modelos, e mostramos a configuração entre parênteses após o nome.
O modelo mais barato é bom o bastante?
Para a maior parte da escrita, dos resumos e das respostas do dia a dia, sim: a faixa barata de um grande fabricante costuma ser uma versão menor do seu carro-chefe. Pague pela faixa cara quando precisar de raciocínio longo e cuidadoso, código complexo ou a melhor resposta possível de primeira.
Continue lendo
- GPT-6 Astra chegou: o que mudou
- Claude Fable 5.1: o modelo que caça bugs
- Por que todas as IAs soam iguais
- Por que o Opus 4.6 encerrou a era do copiloto
- Modelos de raciocínio explicados: IA que pensa antes de falar
Dados de ranking: LMArena. Dados de preços e listagens: OpenRouter. Ambos são creditados em cada tabela; este site não é afiliado a nenhum deles.