xAI, Anthropic, OpenAI e Moonshot AI lançaram quatro modelos de IA de fronteira em três semanas em julho de 2026. xAI disponibilizou Grok 4.5 em 8 de julho, a Anthropic lançou Claude Opus 5 em 24 de julho, a OpenAI levou GPT-5.6 à disponibilidade geral em 9 de julho e a Moonshot AI publicou Kimi K3 em 16 de julho. Cada modelo mira a conclusão de tarefas de várias horas—da pesquisa à codificação até relatórios estruturados—sem perder o controle dos planos de execução. Todos os quatro trazem janelas de contexto de 500.000 tokens ou mais, com três chegando a 1 milhão de tokens, permitindo que sessões únicas processem repositórios inteiros de código ou coleções de documentos.
xAI Lança Grok 4.5 com Dados de Treinamento do Cursor
xAI lançou Grok 4.5 em 8 de julho. O modelo roda em uma base de 1,5 trilhão de parâmetros e foi treinado em parte em dados reais de uso do Cursor, plataforma de codificação que a SpaceXAI adquiriu no início deste ano. O preço fica em US$ 2 por 1 milhão de tokens de entrada e US$ 6 por 1 milhão de tokens de saída, com uma janela de contexto de 500.000 tokens. Elon Musk descreveu Grok 4.5 como um modelo da classe Opus que roda mais rápido e com custo menor. Rastreadres independentes o colocam em 4º lugar no Artificial Analysis Intelligence Index, à frente de qualquer modelo com pesos abertos, com preços mais de 60% abaixo de Claude Opus 4.8 e GPT-5.5. No Terminal-Bench 2.1, um teste que mede o quanto um modelo completa bem tarefas de engenharia via linha de comando, Grok 4.5 pontuou 83,3%. A xAI diz que o modelo precisa de aproximadamente um quinto dos tokens de saída que Opus 4.8 exigiu para tarefas comparáveis.
![Elon X post screenshot.]()
OpenAI Lança GPT-5.6 em Estrutura de Preços em Três Camadas
A OpenAI levou GPT-5.6 à disponibilidade geral em 9 de julho, após um pré-lançamento de duas semanas limitado a cerca de 20 organizações validadas pelo governo dos EUA, em seguida a uma ordem executiva ligada a uma revisão de segurança de modelos de fronteira. A família é lançada em três camadas: Sol, a principal, com preço de US$ 5 de entrada e US$ 30 de saída por 1 milhão de tokens; Terra, um modelo de camada intermediária em US$ 2,50 de entrada e US$ 15 de saída, que a OpenAI diz equivaler ao GPT-5.5 pela metade do custo; e Luna, uma camada rápida e de baixo custo em US$ 1 e US$ 6. A OpenAI relata que Sol lidera o Artificial Analysis Coding Agent Index e atinge 88,8% no Terminal-Bench 2.1, subindo para 91,9% quando o modelo roda quatro subagentes em paralelo sob seu novo modo ultra. As três camadas carregam a maior classificação interna de risco da OpenAI para potencial de uso indevido cibernético e biológico.
![OpenAI X post screenshot.]()
Anthropic Entrega Claude Opus 5 como Modelo Máximo Padrão
A Anthropic lançou Claude Opus 5 em 24 de julho, posicionando-o como um modelo que alcança desempenho próximo ao de Claude Fable 5 pela metade do preço de entrada e saída do Fable, de US$ 10 e US$ 50. Opus 5 mantém a mesma precificação de US$ 5 de entrada e US$ 25 de saída que seu antecessor, Opus 4.8. O modelo é entregue com uma janela de contexto de 1 milhão de tokens, 128.000 tokens máximos de saída e um ajuste de esforço de raciocínio que vai do modo baixo até um novo modo xhigh. A Anthropic diz que Opus 5 estabelece novas marcas no Frontier-Bench e no GDPval-AA, duas avaliações de codificação e trabalho de conhecimento, embora fique atrás do modelo restrito Claude Mythos 5 em tarefas de cibersegurança. Opus 5 agora é o modelo padrão no Claude Max e a opção mais forte no Claude Pro.
![Claude X post screenshot.]()
Moonshot AI Publica Kimi K3 como Maior Modelo com Pesos Abertos
A Moonshot AI lançou Kimi K3 em 16 de julho, um modelo mixture of experts de 2,8 trilhões de parâmetros com 896 especialistas no total e 16 ativos por tarefa. O modelo traz uma janela de contexto de 1 milhão de tokens e entrada nativa multimodal, com preços de API em US$ 3 de entrada e US$ 15 de saída por 1 milhão de tokens. A Moonshot se comprometeu a publicar pesos abertos completos até 27 de julho. K3 é o maior modelo com pesos abertos lançado até hoje, cerca de 75% maior do que o modelo anterior mais usado amplamente com pesos abertos. Rastreadres independentes colocam o K3 em 4º lugar entre os sistemas de fronteira atuais, atrás de Claude Fable 5 e GPT-5.6 Sol, mas à frente de Claude Opus 4.8.
![Kimi Moonshot X post screenshot.]()
Janelas de Contexto Estendidas Permitem Processar Repositório Inteiro
Janelas de contexto abaixo de 200.000 tokens antes forçavam desenvolvedores a quebrar grandes bases de código ou pacotes de pesquisa em fragmentos. Agora, todo modelo deste grupo opera com 500.000 tokens ou mais, com três dos quatro em 1 milhão, permitindo que uma única sessão segure um repositório completo ou uma pilha de documentos de fontes primárias. Sistemas do período de 2023 e 2024 frequentemente perdiam o plano após uma dúzia de chamadas de ferramenta. Os modelos lançados este mês foram construídos para sustentar dezenas de etapas coordenadas e recuperar quando uma chamada de ferramenta retorna dados ruins, em vez de travar. Controles de esforço no Opus 5, preços em camadas no GPT-5.6 e as alegações de eficiência por trás do Grok 4.5 apontam para o mesmo objetivo: permitir que equipes escolham quanto poder de computação uma tarefa merece, em vez de pagar preços de carro-chefe por cada solicitação. O avanço do GPT-5.6 com liberação condicionada ao governo sinaliza que a supervisão agora está embutida nos cronogramas de liberação dos maiores modelos. A breve suspensão, dirigida pelo governo, do acesso a Fable e Mythos pela Anthropic em junho foi uma versão anterior do mesmo padrão.
FAQ
O que os quatro modelos de IA lançados em julho de 2026 têm em comum?
Grok 4.5, Claude Opus 5, GPT-5.6 e Kimi K3 miram a conclusão de tarefas de várias horas—da pesquisa à codificação até relatórios estruturados—sem perder o controle dos planos de execução. Cada modelo tem uma janela de contexto de pelo menos 500.000 tokens, com três chegando a 1 milhão de tokens, permitindo que sessões únicas processem repositórios inteiros de código ou coleções de documentos sem fragmentação.
Por que a OpenAI lançou o GPT-5.6 com um pré-lançamento com liberação pelo governo?
A OpenAI levou GPT-5.6 à disponibilidade geral em 9 de julho, após um pré-lançamento de duas semanas limitado a cerca de 20 organizações validadas pelo governo dos EUA, em seguida a uma ordem executiva ligada a uma revisão de segurança de modelos de fronteira. As três camadas do GPT-5.6 carregam a maior classificação interna de risco da OpenAI para potencial de uso indevido cibernético e biológico, o que disparou a revisão adicional.
Como o preço do Grok 4.5 se compara ao Claude Opus 4.8?
Grok 4.5 custa US$ 2 por 1 milhão de tokens de entrada e US$ 6 por 1 milhão de tokens de saída, mais de 60% abaixo do Claude Opus 4.8 e do GPT-5.5. A xAI diz que o modelo precisa de aproximadamente um quinto dos tokens de saída que Opus 4.8 exigiu para tarefas comparáveis, o que reduz o custo de rodar sessões longas de agentes.