A SpaceXAI lançou nesta quarta-feira, 12 de agosto, o Grok 4.6, nova versão de seu modelo de inteligência artificial voltada a agentes que executam tarefas em várias etapas e à criação de projetos interativos e visuais. O modelo está disponível na API da empresa, no Cursor e no Grok Build, além de parceiros como OpenRouter, Vercel e Cloudflare.
Segundo a SpaceXAI, o Grok 4.6 pode sustentar fluxos de pesquisa, análise, programação e desenvolvimento de aplicações por mais tempo. A empresa afirma que o modelo também passou a testar e verificar partes do próprio trabalho durante trajetórias mais longas. Essas capacidades foram descritas no anúncio e não foram validadas de forma independente nesta apuração.
Contexto, ferramentas e preço
A documentação do Grok 4.6 informa janela de contexto de 500 mil tokens, entrada de texto e imagem, saída em texto e opções configuráveis de raciocínio. Pela plataforma da companhia, o modelo pode usar chamadas de função, busca na web, busca no X e execução de código.
O preço começa em US$ 2 por milhão de tokens de entrada e US$ 6 por milhão de tokens de saída. A versão rápida custa o dobro, segundo a empresa. O valor efetivo de uma aplicação pode variar conforme o volume de tokens processados, o tamanho do contexto e o uso de ferramentas.
O Grok 4.6 sucede o Grok 4.5, lançado em julho com foco em programação, tarefas de agentes e trabalho de conhecimento. No novo anúncio, a SpaceXAI atribui as mudanças a uma etapa suplementar de treinamento mais longa, dados sintéticos filtrados e ambientes voltados a programação, desenvolvimento web, projeto assistido por computador e otimização de kernels.
Resultado no índice da Artificial Analysis
A SpaceXAI diz que o Grok 4.6 iguala o GPT-5.6 Sol no Artificial Analysis Intelligence Index. A comparação também aparece na avaliação independente da Artificial Analysis sobre o Grok 4.6: a variante com raciocínio no nível high recebeu 61 pontos, mesma nota registrada para o GPT-5.6 Sol na base da organização.
O resultado não representa equivalência em todos os usos. Na versão 4.1.1, o índice reúne nove avaliações de texto em inglês e atribui pesos a tarefas de agentes, programação, raciocínio científico e capacidades gerais. A metodologia inclui, entre outros testes, Terminal-Bench, GPQA Diamond e Humanity’s Last Exam.
A Artificial Analysis registrou 56 pontos para o Grok 4.5 no mesmo índice. A diferença de cinco pontos é uma medição da organização, com escopo e metodologia próprios, e não comprova isoladamente as alegações da empresa sobre desempenho em projetos visuais ou trabalho autônomo de longa duração.
No lançamento, a empresa oferece o dobro da franquia incluída no Grok Build e no Cursor durante a primeira semana. A promoção, assim como preços e limites de uso, deve ser conferida nas páginas oficiais antes de uma eventual contratação.