O Kimi K3 é um modelo do tipo Mixture-of-Experts (MoE). Isso significa que, na prática, apenas uma fração de seus parâmetros totais é usada a cada inferência – aproximadamente 50 bilhões dos 2,8 trilhões são ativados por token . Essa característica arquitetural é essencial para entender o número de parâmetros: a Moonshot está sendo honesta sobre o tamanho total, mas um modelo denso equivalente com essa quantidade de parâmetros seria muito mais caro para executar. As principais especificações incluem uma janela de contexto de 1 milhão de tokens, capacidade nativa de visão e entrada multimodal, além de otimização para tarefas de codificação de longo horizonte e agênticas . O lançamento completo dos pesos (open weights) está programado para 27 de julho de 2026 .
O quadro competitivo é cheio de nuances, com evidências consistentes em várias fontes independentes.
K3 supera GPT-5.5 e Claude Opus 4.8. Em benchmarks agregados, o Kimi K3 marca cerca de 80,96 contra 73,51 do GPT-5.5, vencendo em 7 de 9 categorias . Tanto o SCMP quanto a CNBC noticiam que o K3 "supera consistentemente" o GPT-5.5 . Ele também derrota o Claude Opus 4.8, carro-chefe intermediário da Anthropic, em vários benchmarks .
K3 ainda está atrás dos modelos de fronteira. Na inteligência geral agregada, o K3 fica atrás do Claude Fable 5, da Anthropic, e do GPT-5.6 Sol, da OpenAI. No Artificial Analysis Intelligence Index, o Claude Fable 5 marca 60, o GPT-5.6 Sol marca 59 e o Kimi K3 marca 57,1 . A própria Moonshot reconhece essa diferença .
K3 domina em benchmarks de codificação agêntica. É aqui que o K3 realmente brilha. Ele vence 5 de 6 benchmarks de codificação agêntica do mundo real e ficou em primeiro lugar – à frente do Fable 5 – no benchmark Arena de codificação front-end . No Design Arena, o K3 marcou 1.679 pontos, contra 1.631 do Fable 5 e 1.618 do GPT-5.6 Sol .
K3 é muito mais barato. Os custos de inferência são cerca de 50–65% menores por tarefa concluída em comparação com GPT-5.5 ou Claude Opus 4.8, tornando o K3 "o rei do custo-benefício de 2026" para desenvolvedores que lidam com cargas de trabalho agênticas .
Em fevereiro de 2026, a Anthropic acusou formalmente a DeepSeek, a Moonshot AI e a MiniMax de usarem uma técnica de "destilação" para extrair ilegalmente capacidades de seus modelos Claude . De acordo com a Anthropic, os três laboratórios chineses supostamente criaram mais de 24 mil contas fraudulentas e geraram mais de 16 milhões de conversas com o Claude para extrair dados de treinamento . Sozinha, a Moonshot AI foi responsável por mais de 3,4 milhões dessas interações, visando especificamente o raciocínio agêntico, o uso de ferramentas e as capacidades de codificação do Claude .
Em junho de 2026, a Anthropic acusou separadamente a Alibaba – uma das investidoras da Moonshot – de uma campanha de extração similar, classificando-a como "descarada" e "ilegal", em uma carta ao Comitê Bancário do Senado dos EUA, alegando que envolveu 25 mil contas falsas e 28,8 milhões de interações .
A Moonshot AI não admitiu publicamente qualquer irregularidade; as alegações ainda não foram julgadas.
A trajetória financeira da Moonshot AI tem sido extraordinária. Em dezembro de 2024, a empresa estava avaliada em cerca de US$ 4,3 bilhões . Em maio de 2026, ela levantou aproximadamente US$ 2 bilhões em uma rodada liderada pelo braço de venture capital da Meituan, avaliando a empresa em mais de US$ 20 bilhões . Em junho de 2026, começou a buscar uma nova rodada com uma avaliação de US$ 30 bilhões . Poucas semanas após o lançamento do Kimi K3, a Bloomberg noticiou que a Moonshot está se preparando para iniciar discussões em agosto para uma rodada final pré-IPO com uma avaliação de até US$ 50 bilhões . Um IPO em Hong Kong está sendo ativamente considerado; a empresa já realizou conversas com a CICC e o Goldman Sachs desde março de 2026 . A demanda tem sido tão intensa que a Moonshot pausou temporariamente novas assinaturas do Kimi devido à sobrecarga de capacidade .
Os resultados de busca disponíveis não contêm nenhuma reportagem verificada sobre uma alegação da Moonshot AI de que o K3 opera com "supervisão humana mínima". Este parece ser um elemento não suportado – não há evidências suficientes no material fonte para confirmar ou caracterizar tal alegação.
Além disso, embora o contexto mais amplo dos controles de exportação do governo Trump sobre a IA chinesa seja bem estabelecido em reportagens públicas, não foi possível verificar com fontes novas desta seção de busca se a administração está atualmente considerando ativamente a adição de laboratórios de IA chineses específicos (incluindo a Moonshot) à Lista de Entidades (Entity List).