Julho de 2026 virou um ringue de três: a chinesa Moonshot soltou o Kimi K3 no dia 16, a Anthropic segue com o Claude Fable 5 e a OpenAI com o GPT-5.6 Sol. A pergunta que todo mundo faz é uma só: qual a melhor IA agora? Resposta curta: depende do que você quer fazer e de quanto quer pagar. Resposta longa vem abaixo, com número, gráfico e a conta feita.
O placar geral: Fable na frente, mas por pouco
No índice da Artificial Analysis, que junta dezenas de testes num placar só, o Fable 5 lidera com 59,9, o Sol vem colado com 58,9 e o K3 fecha com 57,1, um pouco à frente do Opus 4.8 (56). Antes de cravar campeão, um detalhe que quase ninguém fala: a margem de erro do índice é de cerca de 1 ponto. Ou seja, a diferença entre Sol e K3 (meio ponto) tá dentro do ruído. O que dá pra afirmar: os três estão no mesmo andar, e isso por si só já é notícia, porque um deles vai liberar os pesos de graça.
\n

\n

Cada um vence em um canto
Olhando teste a teste, a coisa fica mais interessante. No Frontend Code Arena, onde devs de verdade votam às cegas em qual interface ficou melhor, o K3 estreou em primeiro lugar com 1.679 pontos de Elo, na frente do Fable 5 (1.631) e do Sol (1.618). Em frontend, o modelinho chinês é máquina, sem discussão.
Só que no GDPval v2, que mede trabalho agêntico de verdade (aquele de longa duração, com ferramenta e planejamento), o Fable 5 abre 92 pontos de Elo sobre o K3: 1.760 contra 1.668. No DeepSWE, de código, o Sol lidera com 73%, Fable com 70% e K3 com 67,5%. E no Terminal Bench 2.1 é quase empate técnico entre Sol (88,8%) e K3 (88,3%), com o Fable atrás (84,6%). Nos 14 benchmarks que os dois lados reportam em comum, o Fable venceu 8 e o K3 venceu 6. Traduzindo: não existe dono do pódio, existe especialista em cada prova.

O preço é onde a briga fica feia
Na API, o K3 cobra US$ 3 por milhão de tokens de entrada e US$ 15 na saída. O Sol cobra US$ 5 e US$ 30. O Fable 5, US$ 10 e US$ 50. Faz a conta: na saída, o Fable custa mais de 3x o K3. Mas tem pegadinha: o K3 gasta bem mais tokens pra terminar a mesma tarefa (quase o dobro do Sol nos testes da Artificial Analysis). No fim, o custo médio por tarefa ficou em US$ 0,94 pro K3 e US$ 1,04 pro Sol. Quase empate, com o Fable jogando na faixa premium.

Conselho de bolso: se você é dev indie pagando API do próprio bolso, K3 (ou o Sonnet 5, que custa os mesmos US$ 3/15) é o ponto de entrada. Fable 5 só se a tarefa justificar cada centavo, tipo agente rodando horas sem supervisão.
O detalhe que ninguém coloca na manchete
Dois poréns importantes antes de você trocar de time. Primeiro: a taxa de alucinação do K3 SUBIU em relação ao antecessor, de 39% pra 51% no teste de confiabilidade factual da Artificial Analysis. Ele acerta mais perguntas, mas também inventa mais quando não sabe. Pra uso sério, isso pesa. Segundo: os números da Moonshot foram medidos no esforço máximo de raciocínio (o modo mais caro e lento) e com harnesses diferentes por teste, então compare com um pé atrás.
Do outro lado da balança, o trunfo que nenhum modelo fechado cobre: os pesos do K3 saem até 27 de julho, com 2,8 trilhões de parâmetros sob licença MIT modificada. É o maior modelo aberto da história. Rodar em casa? Esquece, precisa de centenas de GB de memória, haja GPU. Mas pra empresa que quer hospedar em infra própria, sem risco do modelo ser desligado ou trocado por baixo dos panos, isso não tem preço.
E pra quem tá no Brasil?
API é cobrada em dólar, então a matemática do parágrafo de preço vale dobrada por aqui. Pra quem usa os apps prontos (Kimi, ChatGPT, Claude), a dica é testar o K3 no app gratuito da Kimi antes de assinar qualquer coisa: em frontend e tarefas visuais ele entrega resultado de modelo caro sem pedir cartão.
Na lata: parou de existir “a melhor IA”, existe a melhor pra cada trabalho. Frontend e custo baixo? K3, que dá pra brincar demais. Agente de longa duração e confiabilidade? Fable 5, que venceu onde importa pra trabalho de verdade. Meio-termo equilibrado? Sol. E o lance dos pesos abertos do K3 no dia 27 vai chacoalhar o mercado corporativo de self-host: escuta o que eu tô falando, até o fim do ano tem banco brasileiro rodando modelo chinês em datacenter próprio.
Transparência total: esta matéria foi escrita com ajuda do próprio Fable 5. A gente sabe da piada, por isso os números vieram todos de fonte independente, linkados abaixo, pra você conferir cada um.
E você, qual dos três colocaria pra trabalhar? Me conta nos comentários.
Fontes
ESCRITO PELA IA. REVISADO POR HUMANOS.





