O Kimi K3 é um modelo esparso Mixture-of-Experts (MoE) com as seguintes especificações confirmadas :
A Moonshot chama o K3 de "o primeiro modelo aberto da classe 3T do mundo" . Os pesos abertos foram lançados em 27 de julho de 2026, sob uma licença MIT modificada .
No índice independente Artificial Analysis Intelligence Index (v4.1), o Kimi K3 pontua 57 em sua configuração padrão e 60 na configuração "max" . Seu ranking é :
O índice combina nove avaliações, incluindo GDPval-AA v2, Terminal-Bench 2.1, SciCode, Humanity's Last Exam, GPQA Diamond e raciocínio de contexto longo . Em benchmarks específicos, o Kimi K3 alcançou o #1 no ranking Frontend Code Arena e #2 no AA-Briefcase (trabalho de conhecimento agentivo), atrás apenas do Fable 5 .
O Kimi K3 oferece uma vantagem de custo significativa sobre os rivais proprietários :
Como disse o CEO da Databricks, Ali Ghodsi, à CNBC, a combinação de desempenho em benchmarks e eficiência de custos do K3 torna workloads agentivas antes proibitivas — como agentes de codificação contínua ou processamento de documentos em larga escala — economicamente viáveis para empresas .
O Unity AI Gateway fornece um painel de controle unificado para equipes de plataforma que gerenciam IA em toda a empresa. Os principais recursos aplicáveis ao Kimi K3 incluem :
Durante a mesma semana, o Unity AI Gateway atingiu a Disponibilidade Geral, unificando gerenciamento de gastos, limitação de taxa e controle de acesso em LLMs empresariais, servidores MCP e agentes de codificação .
A Databricks enquadra a integração do Kimi K3 como evidência de que a lacuna entre modelos open-weight e proprietários de IA está se fechando rapidamente . A empresa observa que, há um ano, os melhores modelos open-weight ficavam muito atrás de seus equivalentes proprietários — mas hoje, modelos open-weight como o Kimi K3 rivalizam com os líderes proprietários em desempenho de benchmark, oferecendo custos drasticamente mais baixos e maior flexibilidade .
De acordo com a Databricks, essa mudança permite que as empresas adotem estratégias de IA híbrida, misturando modelos open-weight e proprietários em uma única plataforma governada. A empresa enfatiza que as empresas agora têm escolha genuína — com a capacidade de rotear workloads para o modelo mais econômico para cada tarefa, sem sacrificar desempenho ou governança .