A Moonshot AI lançou o Kimi K3 em 16 de julho de 2026 e o apresentou como o primeiro modelo aberto na classe de 3 trilhões de parâmetros. A questão prática é: pesos abertos e bons benchmarks são suficientes para alcançar a fronteira fechada? Na publicação de lançamento do Kimi K3, a Moonshot afirma que o desempenho do K3 “ainda fica atrás dos modelos proprietários mais poderosos, Claude Fable 5 e GPT-5.6 Sol”. Portanto, não é uma vitória absoluta: o GPT-5.6 Sol foca no teto de qualidade, enquanto o Kimi K3 compete em abertura, contexto e custo.
O GPT-5.6 Sol é o lançamento de fronteira da OpenAI na família GPT-5.6, ao lado de Terra e Luna. O Kimi K3 é a opção de pesos abertos mais forte em sua classe e ocupa a quarta posição no Artificial Analysis Intelligence Index. Ambos expõem APIs compatíveis com OpenAI, então você pode executar o mesmo prompt em kimi-k3 e gpt-5.6-sol no Apidog para comparar qualidade, latência e custo.
TL;DR: veredito
- Escolha o GPT-5.6 Sol quando precisar do maior teto de raciocínio e qualidade em um serviço fechado e hospedado. A própria Moonshot posiciona o Sol acima do K3 em qualidade de ponta.
- Escolha o Kimi K3 quando pesos abertos, auto-hospedagem, contexto de 1 milhão de tokens ou controle rígido de custos forem requisitos.
- Não há benchmark independente direto entre K3 e Sol até agora. A Moonshot afirma que o Sol lidera em capacidade geral; o K3 se destaca em abertura, contexto e preço.
- Teste os dois antes de decidir. Como ambos usam APIs compatíveis com OpenAI, o custo de troca é baixo.
Conheça os modelos
Kimi K3
O Kimi K3 é o carro-chefe da Moonshot AI. Trata-se de um modelo Mixture-of-Experts (MoE) com 2,8 trilhões de parâmetros totais, construído com Kimi Delta Attention, Attention Residuals e Stable LatentMoE.
A arquitetura ativa 16 especialistas de um total de 896 por token. A Moonshot não publicou a contagem de parâmetros ativos, portanto trate os 2,8T como capacidade total, não como computação por token.
Principais características:
- ID do modelo:
kimi-k3 - Entrada: texto e imagem
- Saída: texto
- Janela de contexto: 1 milhão de tokens
- Pesos previstos para abertura por volta de 27 de julho de 2026
- API compatível com OpenAI
Veja mais detalhes no guia O que é Kimi K3.
GPT-5.6 Sol
O GPT-5.6 Sol é o modelo fechado de maior capacidade da família GPT-5.6 da OpenAI. Ele está disponível via API e produtos da OpenAI, mas seus pesos não podem ser baixados ou auto-hospedados.
A OpenAI posiciona o Sol acima de Terra e Luna em capacidade, enquanto os outros modelos atendem a diferentes perfis de custo e latência.
Consulte:
Comparação rápida
| Dimensão | Kimi K3 | GPT-5.6 Sol |
|---|---|---|
| Desenvolvedor | Moonshot AI | OpenAI |
| Lançamento | 16 de julho de 2026 | Família GPT-5.6, 2026 |
| Modelo de acesso | Pesos abertos por volta de 27 de julho de 2026 | Fechado, via API e produto |
| Arquitetura | MoE, 2,8T parâmetros totais, 16/896 especialistas ativos | Não divulgada |
| Qualidade de ponta | Melhor entre os abertos; AA Intelligence Index 57, posição #4/189; atrás do Sol segundo a Moonshot | Modelo de fronteira, posicionado acima do K3 pela Moonshot |
| Contexto | 1.000.000 tokens | Grande; consulte a documentação da OpenAI |
| Entrada | Texto e imagem | Multimodal; consulte a documentação da OpenAI |
| Velocidade de saída | ~62 tokens/s, segundo Artificial Analysis | Varia conforme nível e carga |
| Entrada | US$ 0,30/M com cache-hit; US$ 3,00/M com cache-miss | Consulte o preço atual da OpenAI |
| Saída | US$ 15,00/M | Consulte o preço atual da OpenAI |
| Auto-hospedagem | Sim, quando os pesos forem lançados | Não |
| Ecossistema | Aplicativos Kimi e API compatível com OpenAI | Ferramentas, SDKs e integrações da OpenAI |
| ID do modelo | kimi-k3 |
gpt-5.6-sol — confirme na documentação da OpenAI |
A pontuação 57 no Intelligence Index coloca o K3 em quarto lugar entre 189 modelos acompanhados pela Artificial Analysis. Isso é relevante para um modelo aberto, mas não prova que ele supera o Sol no geral.
Os números diretos disponíveis vêm da própria Moonshot. Trate-os como direcionais até que laboratórios independentes publiquem reproduções. Acompanhe as atualizações em benchmarks do Kimi K3.
Inteligência bruta e qualidade
O GPT-5.6 Sol é a escolha mais segura para tarefas no limite da capacidade atual dos modelos, como:
- planejamento de agentes em múltiplas etapas;
- refatoração de grandes repositórios;
- resolução de problemas complexos de código;
- fluxos que exigem maior confiabilidade de raciocínio.
O Kimi K3, porém, não é um competidor distante. Para muitas cargas de produção — resumo, classificação, RAG, geração de rascunhos e assistência diária de programação — a diferença prática pode ser pequena. Nesses casos, abertura, contexto e preço tendem a pesar mais na escolha.
A Moonshot publicou a seguinte comparação em configuração máxima de raciocínio:
| Benchmark | Kimi K3 | GPT-5.6 Sol |
|---|---|---|
| Terminal-Bench 2.1 | 88,3 | 88,8 |
| DeepSWE | 67,5 | 73,0 |
| BrowseComp | 91,2 | 90,4 |
| Automation Bench | 30,8 | 29,7 |
| SpreadsheetBench 2 | 34,8 | 32,4 |
No placar da própria Moonshot, o K3 vence em BrowseComp, Automation Bench e SpreadsheetBench 2. O Sol vence por pouco no Terminal-Bench 2.1 e tem vantagem clara no DeepSWE, com 73,0 contra 67,5.
O DeepSWE é especialmente relevante se você está construindo agentes de programação. É a melhor indicação disponível de que a vantagem do Sol aparece em tarefas mais difíceis.
A Artificial Analysis também observou que o K3 pode ser prolixo: ele gerou 130 milhões de tokens de saída durante a execução do Intelligence Index, contra uma média de 63 milhões. Como a saída custa US$ 15 por milhão de tokens, limite o tamanho das respostas e use prompts explícitos, por exemplo:
Responda em no máximo 300 palavras.
Não repita o enunciado.
Retorne somente a solução final e os passos essenciais.
Para outra comparação de capacidade, veja Kimi K3 vs Claude Opus 4.8.
Abertura e auto-hospedagem
Aqui o Kimi K3 tem uma vantagem decisiva.
Quando os pesos forem abertos, você poderá:
- Executar o modelo em sua própria infraestrutura.
- Manter prompts e dados sensíveis fora de APIs externas.
- Fazer fine-tuning para o seu domínio.
- Fixar uma versão específica do modelo.
- Evitar cobrança por token em cenários de alto volume.
Isso torna o K3 mais adequado para:
- setores regulamentados;
- ambientes isolados ou air-gapped;
- produtos com requisitos rígidos de residência de dados;
- equipes que precisam auditar ou controlar a versão do modelo.
O GPT-5.6 Sol não oferece esse nível de controle. Ele é fechado e hospedado pela OpenAI. Em troca, você recebe um serviço gerenciado, sem precisar operar GPUs, infraestrutura de inferência e monitoramento de produção.
A escolha é direta:
- K3: mais controle, mais responsabilidade operacional.
- Sol: menos controle, mais conveniência operacional.
Contexto longo e documentos extensos
O Kimi K3 oferece uma janela de contexto de 1 milhão de tokens, aproximadamente 1.500 páginas em uma única solicitação.
Isso pode reduzir a necessidade de fragmentação e recuperação em casos como:
- análise de bases de código extensas;
- revisão de conjuntos grandes de contratos;
- síntese de documentação técnica;
- análise de longas trajetórias de agentes.
Ainda assim, não trate uma janela grande como garantia de recuperação perfeita. Faça testes com seus próprios documentos, perguntas e critérios de avaliação.
O GPT-5.6 Sol também suporta uma janela grande, mas consulte a documentação atual da OpenAI para confirmar o valor disponível.
Preço e controle de custos
O Kimi K3 cobra:
| Tipo de token | Preço |
|---|---|
| Entrada com cache-hit | US$ 0,30 por milhão de tokens |
| Entrada com cache-miss | US$ 3,00 por milhão de tokens |
| Saída | US$ 15,00 por milhão de tokens |
O cache-hit é importante quando sua aplicação reutiliza conteúdo estável, como:
- prompts de sistema extensos;
- instruções de política;
- contexto fixo de uma base de conhecimento;
- templates longos de agente.
Exemplo de padrão que pode beneficiar o cache:
[Prompt de sistema estável]
- Regras do assistente
- Formato de saída
- Políticas de segurança
- Contexto fixo do produto
[Mensagem variável do usuário]
- Pergunta atual
O detalhamento está no guia de preços do Kimi K3.
Para o GPT-5.6 Sol, consulte os preços atuais da OpenAI e compare com o perfil real da sua aplicação. O guia de preços do GPT-5.6 também cobre Terra e Luna, que podem ser alternativas mais econômicas quando o teto do Sol não for necessário.
A conclusão não é que o K3 será sempre mais barato. Ele oferece duas alavancas adicionais:
- entrada barata quando há cache-hit;
- possibilidade de eliminar taxas por token com auto-hospedagem.
Ecossistema, ferramentas e velocidade
O ecossistema da OpenAI é uma vantagem prática para o GPT-5.6 Sol. SDKs, documentação, integrações, chamadas de função e saídas estruturadas são amplamente suportados.
Se sua aplicação já usa APIs da OpenAI, adotar o Sol tende a exigir poucas mudanças. Veja os padrões de integração em como usar a API do GPT-5.6.
O Kimi K3 reduz o custo de migração porque sua API é compatível com o SDK da OpenAI. Em muitos casos, basta alterar:
- a URL base;
- a chave de API;
- o ID do modelo para
kimi-k3.
Exemplo de estrutura de requisição compatível:
{
"model": "kimi-k3",
"messages": [
{
"role": "system",
"content": "Você é um assistente técnico. Responda de forma objetiva."
},
{
"role": "user",
"content": "Explique como implementar autenticação JWT em uma API."
}
]
}
A Artificial Analysis registrou o K3 em aproximadamente 62 tokens por segundo, com tempo para o primeiro token próximo de 2 segundos. A taxa de transferência do Sol varia conforme nível e carga.
Se latência é crítica, não decida apenas com benchmarks públicos. Meça ambos com:
- sua concorrência real;
- seu tamanho médio de prompt;
- seu tamanho esperado de saída;
- seus fluxos com ferramentas;
- seus critérios de timeout.
Matriz de decisão
| Se sua prioridade é… | Incline-se para | Motivo |
|---|---|---|
| Maior qualidade de raciocínio | GPT-5.6 Sol | Posicionado acima do K3 pela Moonshot |
| Pesos abertos e inspecionabilidade | Kimi K3 | Pesos abertos previstos para julho de 2026 |
| Auto-hospedagem ou air-gapped | Kimi K3 | O Sol é fechado e hospedado |
| Residência de dados e privacidade | Kimi K3 | Pode rodar na sua infraestrutura |
| Contexto próximo de 1 milhão de tokens | Kimi K3 | Janela de 1M publicada |
| Ecossistema maduro | GPT-5.6 Sol | SDKs e integrações da OpenAI |
| Entrada barata com forte reutilização de prompt | Kimi K3 | US$ 0,30/M em cache-hit |
| Simplicidade operacional | GPT-5.6 Sol | Serviço totalmente gerenciado |
| Fine-tuning próprio | Kimi K3 | Pesos abertos permitem customização |
| Menor risco em agentes complexos | GPT-5.6 Sol | Maior teto de capacidade |
Casos de uso reais
Fintech com assistente interno de documentos
Se regras de conformidade proíbem enviar dados de clientes para uma API externa, o GPT-5.6 Sol deixa de ser uma opção. O Kimi K3 pode ser auto-hospedado atrás do firewall da empresa quando os pesos estiverem disponíveis.
A janela de 1 milhão de tokens também ajuda na análise de documentos extensos, enquanto a diferença de qualidade de ponta pode não ser relevante para esse cenário.
Startup com copiloto de programação
Se o diferencial do produto é lidar com refatorações que outras ferramentas falham em executar, o GPT-5.6 Sol é a aposta mais segura. A qualidade marginal em tarefas difíceis e o ecossistema da OpenAI podem justificar o preço premium.
Para avaliar a perspectiva do K3 em programação, consulte Kimi K3 para codificação.
Teste Kimi K3 e GPT-5.6 Sol no Apidog
A forma mais confiável de decidir é executar os seus prompts contra os dois modelos.
No Apidog, crie duas requisições de chat completions:
- Uma apontando para a API da Moonshot com
model: "kimi-k3". - Outra apontando para a OpenAI com
model: "gpt-5.6-sol".
Use o mesmo prompt, temperatura e limite de saída. Em seguida, compare:
- qualidade da resposta;
- uso de tokens;
- latência total;
- tempo até o primeiro token;
- custo estimado;
- aderência ao formato esperado.
Armazene as chaves como variáveis de ambiente, nunca diretamente no corpo da requisição.
MOONSHOT_API_KEY=...
OPENAI_API_KEY=...
Baixe o Apidog para montar esse teste. Se preferir trabalhar sem sair do editor, use o Apidog dentro do VS Code.
Conclusão
Kimi K3 e GPT-5.6 Sol atendem a prioridades diferentes.
O Sol é a opção para quem precisa do maior teto de qualidade e de um serviço gerenciado com ecossistema maduro. A própria Moonshot reconhece que ele está à frente do K3 em capacidade bruta.
O K3 é a escolha para quem precisa de pesos abertos, auto-hospedagem, privacidade, contexto de 1 milhão de tokens e maior controle de custos.
- Precisa de qualidade máxima e operação simples? Escolha o GPT-5.6 Sol.
- Precisa controlar pesos, infraestrutura, dados e custos? Escolha o Kimi K3.
Como os dois usam um dialeto de API semelhante, execute o mesmo conjunto de prompts nos dois, registre métricas e decida com base na sua carga de trabalho.
FAQ
O Kimi K3 é melhor que o GPT-5.6 Sol?
Não em qualidade geral de ponta. A própria Moonshot afirma que o K3 ainda fica atrás dos modelos proprietários mais poderosos, incluindo Claude Fable 5 e GPT-5.6 Sol. O K3 se destaca em abertura, contexto de 1 milhão de tokens e flexibilidade de custos.
Existe uma tabela de benchmark direta entre K3 e Sol?
Sim, mas ela foi publicada pela própria Moonshot. Nela, o K3 vence em BrowseComp, Automation Bench e SpreadsheetBench 2; o Sol vence em Terminal-Bench 2.1 e DeepSWE. Trate esses dados como direcionais, não como uma avaliação independente.
Posso auto-hospedar o Kimi K3?
Sim, quando os pesos forem abertos, previsto para aproximadamente 27 de julho de 2026. Isso permite executar o modelo na sua infraestrutura, aplicar fine-tuning e manter dados internamente. O GPT-5.6 Sol é fechado e hospedado.
Quanto custa o Kimi K3?
O K3 cobra US$ 0,30 por milhão de tokens de entrada com cache-hit, US$ 3,00 por milhão com cache-miss e US$ 15,00 por milhão de tokens de saída. A tarifa de cache-hit favorece workloads que reutilizam prompts grandes e estáveis. Para o Sol, consulte os preços atuais da OpenAI.

Top comments (0)