Mesa ao vivo, atualizada diariamente

Ranking de modelos de IA: quem é o nº 1 agora

O placar que as pessoas realmente citam, o preço de cada modelo e os lançamentos do mês, em uma página que se atualiza sozinha.

Em 13 de setembro de 2026, Claude Fable 5.1 (max) da Anthropic lidera o placar de texto da LMArena, com Claude Opus 5 (max) e Claude Opus 4.6 (high) logo atrás.

Entre os modelos de marca, GLM 5.3 Flash é o mais barato de usar, a US$ 0,25 por milhão de tokens de saída, e Claude Fable 5.1 o mais caro, a US$ 50,00.

O topo da tabela costuma ser um empate estatístico: quando as margens de dois modelos se sobrepõem, os votos não conseguem separá-los.

O placar

O placar de texto da LMArena: as pessoas conversam com dois modelos anônimos lado a lado e votam na melhor resposta. Uma linha por modelo; os níveis de raciocínio são agrupados no melhor.

#ModeloFabricantePontuaçãoVotos
1 Claude Fable 5.1 (max) Anthropic 1.508 ±9 5.783
2 Claude Opus 5 (max) Anthropic 1.505 ±5 20.706
3 Claude Opus 4.6 (high) Anthropic 1.503 ±4 71.993
4 Gemini 3.8 Flash (high) Google 1.495 ±9 5.076
5 Claude Fable 5 Anthropic 1.493 ±5 30.057
6 Gemini 3.7 Flash (high) Google 1.490 ±9 5.640
7 Claude Opus 4.7 (high) Anthropic 1.490 ±4 60.002
8 Muse Spark 1.3 (max) Meta 1.490 ±9 4.723
9 Muse Spark 1.2 (xhigh) Meta 1.489 ±11 3.227
10 Gemini 3.5 Flash (high) Google 1.482 ±4 38.257
11 Qwen3.8 (max) Alibaba 1.481 ±6 16.670
12 Muse Spark 1.1 Meta 1.480 ±5 27.615
13 Gemini 3.1 Pro Preview Google 1.480 ±3 106.951
14 Gemini 3 Pro Google 1.479 ±4 40.654
15 Gemini 3.6 Flash (high) Google 1.476 ±5 26.445
16 GLM 5.3 (max)Pesos abertos Z.ai 1.475 ±6 10.960
17 Qwen3.7 Max Preview Alibaba 1.474 ±10 3.705
18 Muse Spark Meta 1.473 ±6 13.565
19 Kimi K3 (max)Pesos abertos Moonshot 1.472 ±5 20.987
20 GLM 5.3 FlashPesos abertos Z.ai 1.472 ±7 10.038
21 Qwen3.5 Max Preview Alibaba 1.471 ±5 21.476
22 GPT-5.5 (high) OpenAI 1.471 ±4 64.924
23 GPT-5.4 (high) OpenAI 1.470 ±4 60.537
24 ERNIE 5.1 Baidu 1.468 ±5 37.058
25 GLM 5.2 (max)Pesos abertos Z.ai 1.467 ±5 36.798

Placar de texto da LMArena, publicado em 13 de setembro de 2026. A pontuação é a nota da arena com sua margem de 95%; linhas com margens sobrepostas estão empatadas estatisticamente.

Melhores modelos de pesos abertos

Os mesmos votos da LMArena, só os modelos cujos pesos você pode baixar e rodar por conta própria. O número cinza é a posição de cada um no placar geral.

#ModeloFabricantePontuaçãoVotos
1 GLM 5.3 (max)nº 20 no geral Z.ai 1.475 ±6 10.960
2 Kimi K3 (max)nº 23 no geral Moonshot 1.472 ±5 20.987
3 GLM 5.3 Flashnº 24 no geral Z.ai 1.472 ±7 10.038
4 GLM 5.2 (max)nº 29 no geral Z.ai 1.467 ±5 36.798
5 Mimo V2.5 Pronº 32 no geral Xiaomi 1.465 ±4 60.919
6 GLM 5.1nº 33 no geral Z.ai 1.462 ±4 48.901
7 Kimi K2.6nº 38 no geral Moonshot 1.455 ±5 37.502
8 DeepSeek V4 Pronº 43 no geral DeepSeek 1.451 ±4 54.130
9 GLM 5nº 51 no geral Z.ai 1.446 ±5 27.605
10 Kimi K2.5 (thinking)nº 53 no geral Moonshot 1.446 ±4 70.513
11 DeepSeek V4 Pro High Previewnº 54 no geral DeepSeek 1.445 ±4 51.485
12 Nvidia Nemotron 3 Ultra 550b A55B Nvfp4nº 55 no geral Nvidia 1.445 ±7 10.693
13 DeepSeek V4 Pro High 20260813nº 58 no geral DeepSeek 1.444 ±7 9.008
14 Gemma 4 31bnº 64 no geral Google 1.442 ±8 5.894
15 Hy3nº 65 no geral Tencent 1.441 ±8 8.047

Placar de texto da LMArena, publicado em 13 de setembro de 2026. A pontuação é a nota da arena com sua margem de 95%; linhas com margens sobrepostas estão empatadas estatisticamente.

Advertisement

Quanto custa cada modelo

Preço de tabela por milhão de tokens do modelo atual de cada família, do mais barato ao mais caro. Um milhão de tokens equivale a cerca de 750 mil palavras de texto, de entrada ou de saída.

ModeloFabricanteEntradaSaídaUS$ 1 compraContexto
GLM 5.3 Flash Z.ai US$ 0,075 US$ 0,25 ≈3 mi palavras 1,3 mi
DeepSeek V4.1 Flash DeepSeek US$ 0,15 US$ 0,60 ≈1,3 mi palavras 1 mi
GPT-5.6 Luna OpenAI US$ 0,20 US$ 1,20 ≈625 mil palavras 1,1 mi
DeepSeek V4 Pro 0813 DeepSeek US$ 0,66 US$ 1,98 ≈378,8 mil palavras 1 mi
Gemini 3.8 Flash Google US$ 0,75 US$ 3,75 ≈200 mil palavras 1 mi
GPT-5.4 Mini OpenAI US$ 0,75 US$ 4,50 ≈166,7 mil palavras 400 mil
Claude Haiku 4.5 Anthropic US$ 1,00 US$ 5,00 ≈150 mil palavras 200 mil
GLM 5.3 Z.ai US$ 1,40 US$ 4,40 ≈170,5 mil palavras 1,3 mi
Grok 4.6 xAI US$ 2,00 US$ 6,00 ≈125 mil palavras 500 mil
GPT-5.6 Sol OpenAI US$ 2,00 US$ 10,00 ≈75 mil palavras 1,1 mi
Claude Sonnet 5 Anthropic US$ 2,00 US$ 10,00 ≈75 mil palavras 1 mi
GPT-5.6 Terra OpenAI US$ 2,00 US$ 12,00 ≈62,5 mil palavras 1,1 mi
Gemini 3.1 Pro Preview Google US$ 2,00 US$ 12,00 ≈62,5 mil palavras 1 mi
Kimi K3 Moonshot US$ 2,648 US$ 13,283 ≈56,5 mil palavras 1 mi
Claude Opus 5 Anthropic US$ 5,00 US$ 25,00 ≈30 mil palavras 1 mi
GPT-6 Astra OpenAI US$ 10,00 US$ 50,00 ≈15 mil palavras 1,1 mi
Claude Fable 5.1 Anthropic US$ 10,00 US$ 50,00 ≈15 mil palavras 1 mi

Dólares por milhão de tokens, entrada e saída. lista pública de modelos da OpenRouter, verificada em 15 de setembro de 2026. São preços de tabela; confirme na página de preços do fabricante antes de orçar, e lembre que os modos de raciocínio cobram o pensamento como saída.

Novo este mês

Modelos de fabricantes conhecidos listados nos últimos 30 dias, os mais recentes primeiro.

ListadoModeloFabricante$/M entrada / saída
há 5 dias10 de set. de 2026 DeepSeek V4.1 Flash DeepSeek US$ 0,15 / US$ 0,60
há 11 dias4 de set. de 2026 GPT-6 Astra OpenAI US$ 10,00 / US$ 50,00
há 11 dias4 de set. de 2026 GPT-6 Astra Pro OpenAI US$ 10,00 / US$ 50,00
há 12 dias3 de set. de 2026 Qwen3.8 Max (0902) Alibaba US$ 2,00 / US$ 6,00
há 13 dias2 de set. de 2026 Muse Spark 1.3 Contributor Meta US$ 0,10 / US$ 0,20
há 13 dias2 de set. de 2026 Muse Spark 1.3 Meta US$ 1,25 / US$ 4,25
há 13 dias2 de set. de 2026 Gemini 3.8 Flash Google US$ 0,75 / US$ 3,75
há 14 dias1 de set. de 2026 Claude Fable 5.1 Anthropic US$ 10,00 / US$ 50,00
há 15 dias31 de ago. de 2026 Granite 4.2 8B IBM US$ 0,06 / US$ 0,25
há 18 dias28 de ago. de 2026 Hy4 preview Tencent US$ 0,834 / US$ 2,501
há 20 dias26 de ago. de 2026 Qwen3.8 Flash Alibaba US$ 0,15 / US$ 0,47
há 20 dias26 de ago. de 2026 GLM 5.3 Flash Z.ai US$ 0,075 / US$ 0,25
há 25 dias21 de ago. de 2026 Muse Spark 1.2 Contributor Meta US$ 0,10 / US$ 0,20
há 25 dias21 de ago. de 2026 DeepSeek V4 Flash Vision Exp DeepSeek US$ 0,22 / US$ 0,66
há 26 dias20 de ago. de 2026 Hy-MT2-1.8B Tencent US$ 0,044 / US$ 0,177
há 26 dias20 de ago. de 2026 Hy-MT2-30B-A3B Tencent US$ 0,074 / US$ 0,295
há 27 dias19 de ago. de 2026 Hy-MT2-7B Tencent US$ 0,074 / US$ 0,295
há 28 dias18 de ago. de 2026 GLM 5.3 Z.ai US$ 1,40 / US$ 4,40

Listagens dos últimos 30 dias de grandes fabricantes, verificadas em 15 de setembro de 2026. Fonte: lista de modelos da OpenRouter.

Como o ranking funciona

A LMArena (a antiga Chatbot Arena do grupo LMSYS da UC Berkeley) mostra ao visitante dois modelos anônimos respondendo à mesma pergunta e pede que escolha a melhor resposta. Milhões desses votos alimentam uma nota Bradley-Terry, a mesma família matemática do Elo do xadrez, de modo que a pontuação de um modelo indica com que frequência ele vence os demais. A margem de 95% ao lado de cada pontuação é a incerteza: um modelo com 5 mil votos tem margem mais larga do que um com 70 mil. Mostramos o placar geral de texto padrão da LMArena, uma linha por modelo. A LMArena lista o mesmo modelo várias vezes com diferentes configurações de raciocínio ("high", "max"); mantemos a mais bem classificada e indicamos a configuração entre parênteses.

Como ler os preços

As empresas de IA cobram por token, e um token equivale a cerca de três quartos de uma palavra em inglês, então um milhão de tokens são aproximadamente 750 mil palavras. Entrada é o que você envia (sua pergunta, o documento colado); saída é o que o modelo escreve de volta. A saída é o lado caro, e os modos de "pensamento" ou raciocínio cobram o raciocínio oculto também como saída, então uma pergunta difícil pode custar várias vezes o que o tamanho da resposta sugere. Os preços aqui são os de tabela do catálogo público da OpenRouter, que espelham as tarifas dos próprios fabricantes; OpenAI, Anthropic e Google também vendem tarifas em lote pela metade do preço para trabalhos que podem esperar. Confirme sempre na página de preços do fabricante antes de orçar.

Advertisement

Qual você deveria usar de fato?

Se você usa IA por um app de chat e não por uma API, o ranking importa menos do que parece. Os dez primeiros estão a poucos pontos uns dos outros, as versões gratuitas de ChatGPT, Claude e Gemini rodam modelos desse grupo, e as diferenças que pesam no dia a dia são os recursos do app: memória, arquivos, voz e se a sua empresa permite. Escolha pelo app de que você gosta e pelo preço que paga. Se você paga por token, a tabela de custos é a que deve ler: a distância entre o modelo de marca mais barato e o mais caro passa de cem vezes, e para o trabalho rotineiro a ponta barata costuma bastar.

O que esta página não diz

Um voto cara a cara mede qual resposta as pessoas preferiram numa janela de chat. Não mede precisão em código, trabalho com documentos longos, compreensão de imagens, velocidade ou como um modelo se comporta dentro de um agente. A LMArena mantém placares separados para vários desses pontos, e conjuntos de benchmarks como o Artificial Analysis publicam índices próprios. Trate esta tabela como o voto popular, não como a eleição inteira.

Perguntas frequentes

Qual é o melhor modelo de IA agora?

Pelos votos às cegas da LMArena, o modelo no topo da tabela desta página. Veja a coluna da margem: quando os primeiros se sobrepõem, estão empatados na prática, e a ordem pode trocar de uma semana para a outra.

Com que frequência esta página é atualizada?

Uma vez por dia. A LMArena publica novos retratos do placar a cada poucos dias e a lista de preços da OpenRouter muda sempre que um fabricante altera um preço ou lista um modelo; a mesa capta as duas coisas na próxima rodada diária e registra sob cada tabela a data da última verificação.

O que significa "pesos abertos"?

O fabricante publicou os pesos do modelo sob uma licença que permite baixá-lo e executá-lo por conta própria, no seu hardware ou numa nuvem alugada, em vez de apenas pela API do fabricante. Modelos proprietários só podem ser usados pela empresa que os criou.

Por que um modelo aparece duas vezes na LMArena e uma vez aqui?

A LMArena pontua o mesmo modelo em diferentes configurações de raciocínio como linhas separadas. Mantemos a configuração mais bem classificada de cada modelo para que a tabela se leia como uma lista de modelos, e mostramos a configuração entre parênteses após o nome.

O modelo mais barato é bom o bastante?

Para a maior parte da escrita, dos resumos e das respostas do dia a dia, sim: a faixa barata de um grande fabricante costuma ser uma versão menor do seu carro-chefe. Pague pela faixa cara quando precisar de raciocínio longo e cuidadoso, código complexo ou a melhor resposta possível de primeira.

Continue lendo

Dados de ranking: LMArena. Dados de preços e listagens: OpenRouter. Ambos são creditados em cada tabela; este site não é afiliado a nenhum deles.

Advertisement