A Moonshot AI lançou o Kimi K3 em 16 de julho de 2026, e o chamou de o primeiro modelo aberto do mundo na classe de 3 trilhões de parâmetros. Essa apresentação levanta uma questão óbvia: se os pesos são abertos e os benchmarks são fortes, o K3 alcança a fronteira fechada? A Moonshot respondeu honestamente em sua publicação de lançamento do Kimi K3, escrevendo que o desempenho do K3 “ainda fica atrás dos modelos proprietários mais poderosos, Claude Fable 5 e GPT-5.6 Sol.” Portanto, esta não é uma volta da vitória. É um confronto entre desafiante e líder: o GPT-5.6 Sol detém a coroa de qualidade de ponta, e o Kimi K3 compete em abertura, comprimento de contexto e preço.
O GPT-5.6 Sol é o lançamento de fronteira da OpenAI na família GPT-5.6, ao lado de Terra e Luna; o Kimi K3 é a opção de pesos abertos mais forte em sua classe, classificado em quarto lugar no Artificial Analysis Intelligence Index. Ambos expõem APIs compatíveis com OpenAI, então, mais tarde, executaremos o mesmo prompt contra kimi-k3 e gpt-5.6-sol no Apidog e compararemos qualidade, latência e custo.
TL;DR: o veredito em resumo
- Escolha GPT-5.6 Sol para o teto mais alto em inteligência bruta e raciocínio dentro do ecossistema fechado e hospedado da OpenAI. A própria Moonshot nomeia Sol como superior ao K3 em qualidade de ponta.
- Escolha Kimi K3 para pesos abertos, auto-hospedagem, uma janela de contexto de 1 milhão de tokens, ou controle de custos rigoroso. É o melhor modelo aberto em sua classe atualmente, com preços de entrada agressivos para cache-hit.
- A lacuna honesta: nenhum benchmark independente e direto de K3 contra Sol existe ainda. Sol lidera em qualidade, segundo as próprias palavras do fornecedor; K3 lidera em abertura, contexto e preço.
- Ambos falam APIs compatíveis com OpenAI, então os custos de troca são baixos, o que torna o teste lado a lado a decisão mais inteligente antes de se comprometer.
Conheça os dois modelos
Kimi K3 é o novo carro-chefe da Moonshot AI, um modelo Mixture-of-Experts (MoE) com 2,8 trilhões de parâmetros totais, construído em componentes personalizados: Kimi Delta Attention, Attention Residuals e um design Stable LatentMoE que ativa 16 especialistas de um total de 896 por token. A Moonshot não publicou a contagem de parâmetros ativos, que geralmente prevê o custo e a velocidade da inferência, então trate 2,8T como capacidade total, e não como computação por token. O K3 é um modelo de raciocínio que aceita entrada de texto e imagem e retorna texto, com uma janela de contexto de 1 milhão de tokens, o ID do modelo kimi-k3, e pesos programados para serem abertos por volta de 27 de julho de 2026. O explicador O que é Kimi K3 aborda a arquitetura.

GPT-5.6 Sol é o modelo de fronteira fechado da OpenAI na geração GPT-5.6, acessível através da API e dos produtos da OpenAI, mas não como pesos para download. A OpenAI posiciona o Sol como o membro de maior capacidade da família, com Terra e Luna em diferentes pontos de custo e latência. Cobrimos a divisão em GPT-5.6 Sol vs Terra vs Luna, e a OpenAI documenta a linha atual e os preços em sua documentação da plataforma. Como a OpenAI itera esses números ao longo do tempo, ancoramos os detalhes do Sol qualitativamente.
Como eles se comparam em resumo
Onde um valor de Sol depende da configuração ao vivo da OpenAI, a célula indica isso em vez de adivinhar.
| Dimensão | Kimi K3 | GPT-5.6 Sol |
|---|---|---|
| Desenvolvedor | Moonshot AI | OpenAI |
| Lançado | July 16, 2026 | GPT-5.6 family, 2026 |
| Modelo de acesso | Pesos abertos (por volta de 27 de julho de 2026) | Fechado, apenas API e produto |
| Arquitetura | MoE, 2.8T parâmetros totais, 16/896 especialistas ativos; contagem de ativos não publicada | Não divulgado |
| Qualidade de ponta | Melhor entre os abertos; AA Intelligence Index 57, rank #4/189; atrás de Sol segundo a Moonshot | Líder de fronteira; posicionado à frente do K3 pela Moonshot |
| Janela de contexto | 1,000,000 tokens | Grande; verificar a documentação do modelo da OpenAI |
| Modalidades de entrada | Texto e imagem | Multimodal; verificar a documentação do modelo da OpenAI |
| Velocidade de saída | ~62 tokens/seg (Artificial Analysis) | Varia por nível e carga; verificar OpenAI |
| Preço de entrada | $0,30/M para cache-hit, $3,00/M para cache-miss | Verificar o preço atual da OpenAI |
| Preço de saída | $15,00/M | Verificar o preço atual da OpenAI |
| Auto-hospedagem | Sim, assim que os pesos forem lançados | Não |
| Ecossistema | Aplicativos Kimi e API compatível com OpenAI | Ferramentas, SDKs e integrações da OpenAI |
| ID do modelo | kimi-k3 |
gpt-5.6-sol (confirmar na documentação da OpenAI) |
Duas ressalvas. A pontuação de 57 no Intelligence Index coloca o K3 em quarto lugar entre 189 modelos rastreados pela Artificial Analysis, notável para um modelo aberto, mas isso não significa que o K3 supera o Sol no geral: o índice agrega muitas avaliações, e a própria Moonshot diz que o Sol está mais alto em qualidade de ponta. Os números diretos existentes são da própria tabela de lançamento da Moonshot abaixo, então trate-os como direcionais até que um laboratório neutro os execute novamente. Atualizaremos a publicação benchmarks do Kimi K3 quando os números independentes chegarem.
Inteligência bruta e qualidade
Este é o território do Sol. Os modelos de fronteira da OpenAI tendem a liderar nas tarefas mais difíceis de raciocínio, agência e codificação, e a própria Moonshot posiciona o Sol acima do K3 em capacidade geral. Se sua carga de trabalho reside na fronteira do que os modelos atuais podem fazer, como planejamento de agente multi-etapas ou refatoração de grandes repositórios, a qualidade marginal no topo da curva é onde o Sol justifica seu valor.
Agora, considere o K3. Um Intelligence Index de 57 e uma quarta colocação significa que ele não é um concorrente distante; ele está na conversa da fronteira. Para uma grande parte do trabalho de produção (resumo, classificação, respostas RAG, rascunho, ajuda diária de codificação), a diferença entre a quarta colocação e o topo é pequena o suficiente para que a maioria dos usuários não a notasse em testes cegos. Muitas vezes, ambos os modelos superam o requisito da sua tarefa, e a decisão então se move para abertura, contexto e custo.
A Moonshot publicou uma tabela de benchmark com uma coluna para o GPT-5.6 Sol. Estes são números gerados pelo fornecedor na configuração de raciocínio máxima, não uma nova execução independente, então considere-os com cautela de campo.
| Benchmark | Kimi K3 | GPT-5.6 Sol |
|---|---|---|
| Terminal-Bench 2.1 | 88.3 | 88.8 |
| DeepSWE | 67.5 | 73.0 |
| BrowseComp | 91.2 | 90.4 |
| Automation Bench | 30.8 | 29.7 |
| SpreadsheetBench 2 | 34.8 | 32.4 |
Lendo honestamente, é uma divisão de 3 a 2 no próprio placar da Moonshot. O K3 supera o Sol em BrowseComp, Automation Bench e SpreadsheetBench 2, enquanto o Sol vence o Terminal-Bench 2.1 por pouco e leva o DeepSWE, a métrica de codificação de agentes mais difícil aqui, por um claro 73,0 a 67,5. Essa última linha é a indicação: a vantagem do Sol aparece onde a dificuldade da tarefa é maior, o que se alinha com a admissão da Moonshot de que o K3 ainda está atrás do Sol no geral.
Uma peculiaridade a considerar: a Artificial Analysis apontou o K3 como prolixo, gerando 130 milhões de tokens de saída durante a execução do Intelligence Index contra uma média de 63 milhões. Como o K3 cobra $15 por milhão de tokens de saída, respostas mais longas custam mais, então planeje o comprimento da saída e aperte os prompts. Para uma leitura de capacidade contra uma linha de base conhecida, Kimi K3 vs Claude Opus 4.8 aplica a mesma lente ao modelo da Anthropic.
Abertura e auto-hospedagem
É aqui que o K3 assume uma vantagem decisiva. Seus pesos serão abertos por volta de 27 de julho de 2026, e isso muda o que você pode fazer: executá-lo em sua própria infraestrutura, manter prompts e dados sensíveis fora dos servidores de terceiros, ajustar (fine-tune) em seu domínio, fixar uma versão para que uma atualização silenciosa nunca altere suas saídas e evitar taxas por token em escala. Para indústrias regulamentadas, ambientes isolados (air-gapped) ou produtos que não podem enviar dados do usuário para uma API externa, um modelo aberto é a única opção que se encaixa.
O GPT-5.6 Sol não oferece nada disso. Ele é fechado e hospedado: você obtém a confiabilidade e as ferramentas da OpenAI, mas o modelo vive nos servidores da OpenAI, você não pode inspecioná-lo ou modificá-lo, e o preço, a disponibilidade e o comportamento são de responsabilidade da OpenAI para alterar. Muitas equipes aceitam essa troca, já que executar um modelo da classe de 3 trilhões de parâmetros por conta própria exige GPUs sérias, uma pilha de inferência e uma verdadeira força de operações. A questão é controle versus conveniência: o K3 entrega as chaves; o Sol entrega um serviço bem gerenciado.
Janela de contexto e trabalho com documentos longos
O Kimi K3 oferece uma janela de contexto de 1 milhão de tokens, aproximadamente 1.500 páginas em uma única solicitação, o que elimina grande parte da necessidade de fragmentação e recuperação para análise de bases de código completas, grandes conjuntos de contratos ou longas trajetórias de agentes. O GPT-5.6 Sol também suporta uma janela grande; a OpenAI publica o valor atual em sua documentação de modelo, e não fabricaremos um número que ela ajusta entre lançamentos. Uma ressalva: uma janela grande é capacidade, não uma garantia de recuperação perfeita, então meça a fidelidade em seus próprios documentos em vez de confiar no título.
Preços e controle de custos
O Kimi K3 cobra $0,30 por milhão de tokens para entrada com cache-hit, $3,00 por milhão para entrada com cache-miss e $15,00 por milhão de tokens de saída. A taxa de cache-hit é o que chama a atenção: se sua aplicação reutiliza um prompt de sistema grande ou um contexto de documento estável e ele permanece em cache, seu custo de entrada cai em uma ordem de magnitude em comparação com o cache-miss. Isso recompensa a reutilização intensa de prompts, como um chat sobre uma base de conhecimento fixa. O detalhamento de preços do Kimi K3 explica a matemática.
Os preços do GPT-5.6 Sol são definidos pela OpenAI, e modelos fechados de fronteira geralmente têm um preço premium. Verifique os preços atuais da OpenAI em relação à sua própria combinação de tokens; o guia de preços do GPT-5.6 abrange os níveis, e Terra e Luna oferecem pontos mais baratos quando o teto do Sol é um exagero. A conclusão não é que o K3 seja sempre mais barato, mas que ele oferece duas alavancas que o Sol não oferece: um preço de entrada agressivo para cache-hit e a opção de pular as taxas por token através da auto-hospedagem.
Ecossistema, ferramentas e velocidade
O ecossistema da OpenAI é uma verdadeira vantagem para o Sol. Seus SDKs, documentação, integrações e ferramentas para chamada de função e saídas estruturadas são maduros e amplamente suportados, então, se sua pilha já funciona com OpenAI, adotar o Sol é quase gratuito em termos de esforço de engenharia; cobrimos os padrões de chamada em como usar a API do GPT-5.6. O Kimi K3 diminui essa lacuna: sua API é compatível com o SDK da OpenAI, então você altera a URL base e o ID do modelo para kimi-k3 e a maioria do código continua funcionando, o que torna um confronto direto K3 versus Sol realista em vez de uma reescrita. O K3 também está presente nos próprios produtos da Moonshot, incluindo Kimi Code e Kimi Work.
Em termos de velocidade, a Artificial Analysis registrou o K3 em cerca de 62 tokens por segundo, com um tempo para o primeiro token próximo a 2 segundos, abaixo da mediana de aproximadamente 73 para modelos de raciocínio em uma faixa de preço similar. A taxa de transferência do Sol varia por nível e carga, então meça a velocidade sob sua própria concorrência e avalie ambos com cargas úteis realistas se a latência for crítica e voltada para o usuário.
A matriz de decisão
Isso mapeia o eixo que você se importa para o modelo que tende a vencer nele.
| Se sua prioridade é… | Incline-se para | Por quê |
|---|---|---|
| Qualidade de raciocínio de ponta absoluta | GPT-5.6 Sol | Posicionado à frente do K3 pela própria publicação de lançamento da Moonshot |
| Pesos abertos e inspecionabilidade | Kimi K3 | Pesos abertos por volta de 27 de julho de 2026 |
| Auto-hospedagem ou implantação em ambiente isolado (air-gapped) | Kimi K3 | Sol é fechado e apenas hospedado |
| Residência de dados e controle de privacidade | Kimi K3 | Execute-o em sua própria infraestrutura |
| Contexto muito longo (próximo de 1M de tokens) | Kimi K3 | Janela de 1M publicada |
| Ecossistema e ferramentas maduros | GPT-5.6 Sol | SDKs e integrações da OpenAI |
| Entrada barata com forte reutilização de prompt | Kimi K3 | Entrada de $0,30/M para cache-hit |
| Simplicidade operacional, sem carga de operações | GPT-5.6 Sol | Serviço totalmente gerenciado |
| Fine-tuning em seu próprio domínio | Kimi K3 | Pesos abertos permitem isso |
| Menor risco nas tarefas de agente mais difíceis | GPT-5.6 Sol | Teto de fronteira |
Sol vence nas colunas de qualidade e conveniência; K3 vence nas colunas de controle, contexto e custo. São sistemas de valores diferentes, então uma ferramenta interna sensível à privacidade e um produto de agente de fronteira escolhem corretamente modelos opostos.
Casos de uso reais
Uma fintech construindo um assistente de documentos interno. As regras de conformidade proíbem o envio de dados de clientes para uma API externa, o que elimina o Sol e aponta diretamente para o Kimi K3, cujos pesos abertos permitem que a equipe o auto-hospede por trás de seu próprio firewall. A janela de contexto de 1 milhão de tokens ajuda com documentos extensos, e a qualidade é mais do que adequada, então a pequena diferença de ponta não altera a decisão.
Uma startup lançando um copiloto de codificação de ponta. Seu argumento principal é lidar com refatorações que outras ferramentas estragam, então a confiabilidade marginal do GPT-5.6 Sol em tarefas difíceis é o produto, e as ferramentas da OpenAI encurtam o desenvolvimento. A equipe paga o preço premium e permanece com um modelo fechado. Para a visão do K3 para codificação, veja Kimi K3 para codificação.
Teste ambos um contra o outro no Apidog
A melhor forma de resolver um debate sobre qualidade versus custo é executar seus próprios prompts em ambos, lado a lado. Como K3 e Sol são ambos compatíveis com OpenAI, o Apidog torna isso um exercício de cinco minutos. Crie duas requisições para o endpoint de chat completions de cada provedor: uma com a URL base definida para a API da Moonshot e o modelo kimi-k3, a outra apontada para a OpenAI com gpt-5.6-sol. Envie o prompt idêntico para ambos e compare a qualidade da resposta, o uso de tokens e a latência. Armazene suas chaves de API como variáveis de ambiente para que nada vaze para o corpo da requisição. Baixe o Apidog para configurá-lo, e o Apidog dentro do VS Code mantém o loop próximo ao seu código.
Conclusão
Kimi K3 e GPT-5.6 Sol não estão realmente competindo pelo mesmo trabalho. O Sol é a aposta em qualidade de ponta e ecossistema, e o próprio post de lançamento da Moonshot concede que ele está à frente do K3 em capacidade bruta. O K3 é a aposta em abertura, contexto longo e custo, e é o modelo aberto mais forte em sua classe, em vez de um compromisso. Precisa do teto mais alto e de um serviço gerenciado? O Sol é a aposta mais segura. Precisa possuir os pesos, manter os dados internamente, trabalhar com uma janela de contexto de 1 milhão de tokens ou reduzir o custo de entrada com cache? O K3 se encaixa. Como ambos falam o mesmo dialeto de API, aponte-os para o mesmo prompt, meça e deixe que seus próprios números decidam.
FAQ
O Kimi K3 é melhor que o GPT-5.6 Sol? Não em qualidade geral de ponta. A própria publicação de lançamento da Moonshot afirma que o K3 ainda fica atrás dos modelos proprietários mais poderosos, citando Claude Fable 5 e GPT-5.6 Sol. O K3 lidera em abertura, sua janela de contexto de 1 milhão de tokens e flexibilidade de preços, mas não afirma superar o Sol em inteligência bruta.
Existe uma tabela de benchmark direta K3 versus Sol? Sim, mas até agora apenas uma executada pelo fornecedor. A publicação de lançamento da Moonshot publica uma tabela onde o K3 vence em BrowseComp, Automation Bench e SpreadsheetBench 2, e o Sol vence em Terminal-Bench 2.1 e DeepSWE. Esses são os próprios números da Moonshot, não uma nova execução independente, então trate-os como direcionais.
Posso auto-hospedar o Kimi K3? Sim, assim que os pesos forem abertos por volta de 27 de julho de 2026. Isso permite que você execute o K3 em sua própria infraestrutura, faça o fine-tuning e mantenha os dados internamente. O GPT-5.6 Sol é fechado e apenas hospedado.
Quanto custa o Kimi K3? O K3 cobra $0,30 por milhão de tokens para entrada com cache-hit, $3,00 por milhão para entrada com cache-miss e $15,00 por milhão de tokens de saída. A taxa de cache-hit recompensa cargas de trabalho que reutilizam um prompt grande e estável. Para o Sol, verifique os preços atuais da OpenAI.
