
Kimi K3 vs Fable 5: O Que é, Quanto Custa, Como Usar e Onde Ele Vence
Kimi K3 vs Fable 5: O Que é, Quanto Custa, Como Usar e Onde Ele Vence
Kimi K3 vs Fable 5: O Que é, Quanto Custa, Como Usar e Onde Ele Vence
O Kimi K3, modelo chinês de peso aberto, superou o Fable 5 em programação front-end e custa um terço. Com 2,8 trilhões de parâmetros, ele desafia modelos de ponta a preço baixo, apesar de gargalos de capacidade.
Um modelo chinês de código aberto acabou de superar o Claude Fable 5 num ranking de programação de front-end, e fez isso pela metade do preço de rodar os modelos de ponta americanos. O Kimi K3, da Moonshot AI, é o maior modelo de peso aberto já lançado, e a repercussão foi tão grande que a empresa teve que pausar novas assinaturas em 48 horas porque a demanda estourou a capacidade de GPU. Isso ninguém no Brasil te contou ainda.
Eu testo e integro esses modelos no meu trabalho, então vou te dar a matéria completa: o que o Kimi K3 é, como usar, quanto custa de verdade em real, as novidades de mercado que a imprensa ainda não destacou, e o comparativo honesto contra o Fable 5, incluindo onde ele decepciona.
Resumo pra quem tem pressa
O Kimi K3 é o modelo mais capaz da Moonshot AI, lançado em 16 de julho de 2026, com 2,8 trilhões de parâmetros, o maior modelo de peso aberto do mundo.
Ele ficou em primeiro lugar no ranking de código front-end da Arena, à frente do Fable 5, em teste cego de desenvolvedores.
No geral, fica em quarto entre todos os modelos de ponta: atrás do Fable 5 e do GPT-5.6 Sol, mas à frente do Opus 4.8 e do GPT-5.5.
Preço de API: US$ 3 por milhão de tokens de entrada e US$ 15 de saída, com entrada em cache a apenas US$ 0,30. É a faixa do Claude Sonnet, muito mais barato que o Fable 5.
Tem 1 milhão de tokens de contexto, visão nativa e arquitetura MoE que ativa só 16 de 896 especialistas por token.
Novidade pouco noticiada: a Moonshot pausou novas assinaturas em 19 de julho por falta de GPU, e vai dividir o produto em duas assinaturas separadas.
Limitação real: ele sempre raciocina, e como o raciocínio é cobrado como saída, a conta sobe mais do que o preço de tabela sugere.
O que é o Kimi K3, sem marketing
Vou direto ao que importa. O Kimi K3 é o modelo principal da Moonshot AI, uma startup de Pequim apoiada por gigantes como Alibaba e Tencent. Ele foi lançado em 16 de julho de 2026 e tem 2,8 trilhões de parâmetros totais, o que a empresa chama de primeiro modelo aberto da classe de 3 trilhões e o maior modelo de peso aberto já disponibilizado.
A parte técnica que importa para o bolso: ele usa uma arquitetura de mistura de especialistas (MoE, na sigla em inglês). Isso significa que, apesar dos 2,8 trilhões de parâmetros, só uma fração pequena da rede é usada a cada token, apenas 16 dos 896 especialistas, cerca de 1,8% do total. É isso que permite entregar capacidade de ponta a um custo muito menor de processamento. Ele também tem visão nativa, ou seja, entende imagem, e uma janela de contexto de 1 milhão de tokens, o que permite engolir uma base de código inteira ou documentos enormes numa só conversa.
O Kimi K3 é a prova de que a China parou de competir só no preço e passou a competir na capacidade. Ele é o primeiro modelo aberto que enfrenta os melhores sistemas americanos de igual para igual, não como alternativa barata.
Essa virada da IA de peso aberto muda o jogo de quem constrói, e conversa direto com o que eu venho falando sobre modelos e agentes em como ganhar dinheiro com IA, modelos e agentes.
Quanto custa de verdade, em real
Aqui está o maior atrativo do Kimi K3, e onde mora uma pegadinha. O preço de API é agressivo: US$ 3 por milhão de tokens de entrada, US$ 15 por milhão de saída, e apenas US$ 0,30 por milhão de tokens de entrada em cache. Para comparar, isso é a faixa do Claude Sonnet, e uma fração do que custa rodar o Fable 5.
Mas atenção à letra miúda, porque é ela que faz a conta real subir. O Kimi K3 sempre raciocina, não existe um modo "instantâneo" mais barato para desligar o pensamento, como havia em gerações anteriores. E os tokens de raciocínio são cobrados como tokens de saída, a US$ 15 o milhão. Ou seja, um raciocínio interno longo pode custar mais que a resposta visível. Para tarefa simples e de alto volume, o custo por chamada é maior do que o preço de tabela sugere.
E, como sempre lembro para quem paga do Brasil, todo esse valor é em dólar. Sobre cada uso incidem o câmbio, o IOF de 3,5% e o spread do banco, algo que eu detalho em dólar na conta. O preço parece baixo, mas faça a conta convertida antes de escalar o uso.
Os planos de assinatura do app
Se você quer usar pelo app em vez da API, a Moonshot trabalha com planos de nomes musicais. O Adagio é a camada gratuita, boa para testar com poucos créditos de agente. O Moderato, por volta de US$ 19 por mês (com promoção listada a US$ 15), é o mínimo que libera o K3, limitado a 256 mil tokens de contexto. O Allegretto, por volta de US$ 39 por mês, libera a janela completa de 1 milhão de tokens e o modo de alta velocidade. A regra prática: comece no gratuito para testar, e só suba de plano quando esbarrar no limite.
Como usar o Kimi K3 na prática
Você tem três caminhos, e cada um serve a um perfil. Vou explicar sem enrolação.
1. Pelo app, para uso do dia a dia
O caminho mais simples. Você assina um plano (Moderato ou superior para ter o K3) e usa direto na interface do Kimi, como faria com qualquer assistente. Ideal para quem quer usar o modelo para pensar, escrever e programar sem montar integração.
2. Pela API, para quem constrói produto
Este é o caminho para desenvolvedor. A API do Kimi K3 usa o mesmo formato da API da OpenAI, então qualquer código que já funciona com a OpenAI passa a funcionar mudando só o endereço base para o da Moonshot e o nome do modelo para kimi-k3. Essa compatibilidade é uma jogada inteligente, porque elimina o atrito de migração. Você aponta seu sistema existente para o novo modelo e testa em minutos.
3. Por um agregador, para comparar modelos
Se você não quer gerenciar uma assinatura da Moonshot, dá para acessar o K3 por plataformas que reúnem vários modelos num lugar só, o que é ótimo para comparar a saída dele com a de outros modelos de ponta antes de decidir. É a mesma lógica de escolher a ferramenta certa por tarefa que eu defendo em gerenciar um SaaS é equilibrar funcionalidade e custo.
Novidades de mercado que ainda não destacaram
Aqui está o que separa esta matéria do que você vai ler em outro lugar. Dois movimentos recentes e pouco noticiados mudam a leitura sobre o Kimi K3.
A demanda estourou a capacidade e travou novas assinaturas
Este é o furo. Em torno de 19 de julho de 2026, apenas alguns dias após o lançamento, a Moonshot pausou temporariamente novas assinaturas porque a demanda empurrou o uso para perto do limite da capacidade de GPU da empresa, em menos de 48 horas. Quem já era assinante manteve o acesso, e a empresa prometeu reabrir as inscrições em lotes. Isso diz duas coisas: o interesse pelo modelo é real e gigante, e a Moonshot tem um gargalo de infraestrutura que pode limitar a experiência no curto prazo. Depender de um serviço que pode travar por capacidade é um risco que precisa entrar na sua decisão.
O produto vai se dividir em duas assinaturas
A segunda novidade: a Moonshot anunciou que vai separar o produto em duas assinaturas distintas daqui para frente, uma para uso geral no app e web, e outra voltada para uso de programação. Para quem for adotar o Kimi no fluxo de trabalho, isso significa ficar de olho em qual assinatura cobre o seu caso de uso, para não pagar pela camada errada.
Quando um modelo novo trava as próprias assinaturas por excesso de procura em dois dias, o problema deixou de ser convencer o mercado e passou a ser dar conta dele. Isso é sinal de força e de gargalo ao mesmo tempo.
O modo de raciocínio ganhou níveis, mas de forma desigual
No lançamento, o K3 só tinha o modo de esforço máximo de raciocínio, o que o deixava caro e lento para tarefa simples. Poucos dias depois, a Moonshot adicionou os níveis padrão e alto, dando controle sobre o custo contra a velocidade. Mas há um detalhe técnico: essa atualização chegou primeiro ao ambiente de programação, enquanto a API principal ainda indicava só o máximo disponível. Ou seja, a capacidade de escolher o esforço depende de onde você acessa o modelo.
Kimi K3 vs Fable 5: o comparativo honesto
Chega ao ponto que você pediu. Como o Kimi K3 se compara ao Claude Fable 5, o modelo mais capaz da Anthropic? A resposta é mais interessante do que um simples "qual é melhor".
Onde o Kimi K3 ganha
Preço. Este é o nocaute. O K3 custa US$ 3 e US$ 15 por milhão de tokens, contra US$ 10 e US$ 50 do Fable 5. É cerca de um terço do custo de saída, uma diferença brutal em escala.
Código de front-end. Em teste cego na Arena, o K3 ficou em primeiro lugar em código de front-end, à frente do Fable 5, vencendo em 6 de 7 domínios avaliados.
Abertura. O K3 é de peso aberto, com os pesos completos prometidos sob licença permissiva. O Fable 5 é fechado. Para quem quer rodar por conta própria ou auditar o modelo, isso é decisivo.
Onde o Fable 5 ganha
Capacidade geral. No conjunto amplo de avaliações, o Fable 5 continua à frente do K3. A própria Moonshot admite que o K3 fica atrás do Fable 5 e do GPT-5.6 Sol no desempenho geral.
Engenharia em escala real. O Fable 5 mantém a liderança nos testes mais próximos de engenharia de software em repositório grande, o trabalho pesado de código de verdade.
Maturidade e infraestrutura. O Fable 5 roda numa infraestrutura consolidada, enquanto o K3 já mostrou gargalo de capacidade. Para operação que não pode parar, isso pesa.
O veredito prático
Não existe vencedor absoluto, existe encaixe. O Kimi K3 é a escolha quando o custo importa muito e a tarefa é código, principalmente front-end, ou quando você precisa de um modelo aberto para rodar por conta própria. O Fable 5 é a escolha quando você precisa da máxima capacidade geral e de infraestrutura confiável, e o custo é secundário diante do resultado. Muita gente vai acabar usando os dois: o K3 para o volume de código onde ele brilha e custa pouco, o Fable 5 para o trabalho mais complexo. Sobre essa saga do Fable 5 e seus custos, eu escrevi em detalhe na volta do Claude Fable 5.
As limitações que você precisa conhecer
Nenhuma ferramenta é só virtude, e um post honesto mostra os defeitos. As limitações reais do Kimi K3:
Raciocínio sempre ligado. Não dá para desligar o pensamento. Para tarefa de alto volume e sensível a custo, como classificação simples ou resposta curta, o piso de custo por chamada é mais alto do que parece.
Trocar de modelo no meio da sessão sai caro. A documentação da Moonshot é clara: trocar de modelo invalida o cache de contexto e força reprocessar tudo ao preço cheio de US$ 3 por milhão, em vez dos US$ 0,30 do cache. É uma diferença de dez vezes. A regra é começar sessão nova, nunca trocar no meio.
Menos controles de ajuste. Parâmetros que desenvolvedores costumam ajustar vêm fixos, e o controle de custo mora na gestão de sessão e de contexto, não nos parâmetros da requisição.
Gargalo de capacidade. Como a pausa de assinaturas mostrou, a infraestrutura ainda pode não dar conta de picos de demanda.
Pesos completos ainda não liberados no lançamento. A promessa de peso aberto só se concretiza quando os arquivos saem, previstos para 27 de julho de 2026. Até lá, na prática, não dá para rodar localmente.
A virada: um novo player que você não pode ignorar
O Kimi K3 é um daqueles lançamentos que reorganizam o mapa. Ele mostra que a IA de peso aberto alcançou o territorio dos modelos fechados de ponta, e faz isso a um custo que force todo mundo a repensar preço. Ignorar isso porque é um modelo chinês seria um erro de quem confunde origem com qualidade. Ele é rápido, capaz em código e barato, e isso é uma combinação rara.
Meu chamado é prático: teste o K3 na tarefa em que ele mais promete, código, principalmente front-end, usando a camada gratuita ou a API compatível com a OpenAI, e compare o resultado e o custo com o que você já usa. Se ele entregar o mesmo resultado por um terço do preço no seu caso, é dinheiro economizado todo mês. Mas trate o gargalo de capacidade e o raciocínio sempre ligado como riscos reais, e nunca dependa de um único fornecedor para operação crítica. E como todo esse jogo se decide na conta em dólar que entra na sua operação, controlar esse custo é parte do trabalho. É para enxergar essa conta de forma simples que eu mantenho o Controle, meu sistema de gestão financeira.
A corrida da IA deixou de ser assunto de dois ou três nomes americanos. Quem olhar só para o lado de sempre vai perder a ferramenta que talvez resolva o seu problema pela metade do preço.
Perguntas frequentes
O que é o Kimi K3?
É o modelo de inteligência artificial mais capaz da Moonshot AI, uma startup chinesa, lançado em 16 de julho de 2026. Com 2,8 trilhões de parâmetros, é o maior modelo de peso aberto do mundo. Tem arquitetura de mistura de especialistas, visão nativa e janela de contexto de 1 milhão de tokens, sendo forte em programação e trabalho com agentes.
Quanto custa o Kimi K3?
Pela API, custa US$ 3 por milhão de tokens de entrada e US$ 15 por milhão de saída, com entrada em cache a apenas US$ 0,30. Pelo app, o plano Moderato (cerca de US$ 19 por mês) libera o modelo, e o Allegretto (cerca de US$ 39) libera a janela completa de 1 milhão de tokens. Há uma camada gratuita, o Adagio, para testes. Some câmbio e IOF ao pagar do Brasil.
O Kimi K3 é melhor que o Claude Fable 5?
Depende da tarefa. O K3 supera o Fable 5 em código de front-end num teste cego e custa cerca de um terço do preço, além de ser de peso aberto. Mas o Fable 5 mantém liderança na capacidade geral e em engenharia de software em escala real, com infraestrutura mais madura. O K3 ganha em custo e front-end, o Fable 5 em capacidade geral e confiabilidade.
Como faço para usar o Kimi K3?
Há três caminhos: pelo app do Kimi, assinando um plano Moderato ou superior; pela API, que é compatível com a da OpenAI, bastando mudar o endereço base e usar o ID kimi-k3; ou por um agregador que reúne vários modelos, útil para comparar. Para desenvolvedores, a compatibilidade com a API da OpenAI torna a migração quase imediata.
Qual a principal limitação do Kimi K3?
A mais relevante é que ele sempre raciocina, sem um modo instantâneo mais barato. Como os tokens de raciocínio são cobrados como saída, a US$ 15 o milhão, o custo real por chamada pode ser mais alto que o preço de tabela sugere, especialmente em tarefas simples e de alto volume. Além disso, trocar de modelo no meio da sessão invalida o cache e encarece o uso.
O Kimi K3 é realmente de código aberto?
É de peso aberto, com uma ressalva de tempo. No lançamento, em 16 de julho de 2026, os pesos completos ainda não tinham sido publicados. A liberação sob licença permissiva estava prevista para 27 de julho de 2026. Até os arquivos saírem de fato, o modelo não pode ser baixado nem rodado localmente, funcionando apenas como serviço hospedado.
Quer mais conteúdo desse?
Receba toda semana o que escrevo sobre stack, IA aplicada e negócios solo. Zero spam, descadastro num clique.