Grok 4.7 estreia como a 3ª melhor IA do mundo cobrando menos
A SpaceXAI lançou nesta segunda-feira (21) o Grok 4.7 , novo modelo de inteligência artificial voltado principalmente para programação, agentes autônomos e trabalhos profissionais mais longos. Segundo avaliações independentes da Artificial Analysis, a novidade colocou o laboratório de Elon Musk entre os principais nomes do setor e alcançou o 3º lugar entre empresas em programação agêntica , atrás apenas de Anthropic e OpenAI.
Além do desempenho, a empresa aposta no preço. O Grok 4.7 custa a partir de US$ 2 por 1 milhão de tokens de entrada e US$ 6 por 1 milhão de tokens de saída , abaixo de modelos avançados como GPT-5.6 Sol e Claude Fable 5.1.
O Grok 4.7 usa um modelo-base maior do que o Grok 4.6 e passou por um período mais longo de treinamento por reforço, com maior peso para tarefas que podem levar horas para serem concluídas.
Segundo a SpaceXAI, isso tornou o sistema melhor em revisar o próprio trabalho, manter informações relevantes durante tarefas extensas e trabalhar com ferramentas externas. O modelo também foi treinado especificamente para operar com o Grok Bot, agente da empresa voltado à execução de tarefas.
Nos testes próprios da companhia, o Grok 4.7 alcançou 46,3% no CursorBench 4.0 , voltado a programação de longa duração, contra 40,4% do Grok 4.6 e 41,7% do GPT-5.6 Sol Max. No DeepSWE, outro benchmark de engenharia de software, marcou 71%, próximo dos 72,7% do modelo da OpenAI.
O modelo também apresentou bons resultados em atividades profissionais. No AA Briefcase, que mede tarefas de várias horas semelhantes às realizadas por profissionais, chegou a 1.657 pontos , contra 1.487 do GPT-5.6 Sol e 1.678 do Claude Fable 5.1 nos testes divulgados pela SpaceXAI.
A posição precisa de contexto. Elon Musk afirmou que o Grok 4.7 colocou a SpaceXAI em terceiro lugar entre laboratórios no segmento de programação agêntica , atrás de Anthropic e OpenAI.
Na avaliação independente da Artificial Analysis, o Grok 4.7 com Grok Build marcou 56 pontos no Coding Agent Index , nove a mais que a geração anterior. Entre modelos executados com as ferramentas de seus próprios desenvolvedores, ficou atrás apenas de Claude Fable 5.1, GPT-6 Astra e Claude Opus 5.
Já no Artificial Analysis Intelligence Index , que reúne diferentes tipos de tarefas e oferece uma visão mais geral de capacidade, o Grok 4.7 recebeu 46 pontos e aparece mais abaixo no ranking geral. Portanto, o “terceiro lugar” não significa que ele seja literalmente a terceira melhor IA em qualquer tipo de uso.
Para requisições com até 200 mil tokens de contexto, a API do Grok 4.7 cobra US$ 2 por milhão de tokens de entrada e US$ 6 pela saída . Acima desse limite, os valores passam para US$ 4 e US$ 12, respectivamente.
O GPT-5.6 Sol, por comparação, custa US$ 4 na entrada e US$ 20 na saída em sua tarifa padrão. Já o Claude Fable 5.1 cobra US$ 10 e US$ 50 , respectivamente.
A comparação não significa que os três modelos entreguem o mesmo desempenho em todas as tarefas.
Resumo agregado pelo 5News a partir do feed público do veículo. A matéria completa, com todo o contexto, está em canaltech.com.br — o conteúdo pertence a Canaltech.