Novo modelo de IA da Meta já roda em hardware AMD sem depender da nuvem
O Meta Superintelligence Labs liberou o Muse Glimmer , um modelo de linguagem denso de 30 bilhões de parâmetros com pesos abertos sob licença Apache 2.0, projetado especificamente para execução local de cargas de trabalho agentes.
Em testes preliminares realizados no Windows com o projeto llama.cpp utilizando backend Vulkan e decodificação especulativa dFlash , o modelo atingiu até 24 tokens por segundo em um processador AMD Ryzen AI Max+ 395 e até 53 tokens por segundo em uma única placa de vídeo AMD Radeon AI PRO R9700 .
O anúncio posiciona o hardware AMD como caminho para viabilizar sistemas de inteligência artificial com memória persistente , uso de ferramentas e privacidade de dados diretamente na máquina do usuário, eliminando latência e custos recorrentes com tokens associados a abordagens focadas em nuvem.
Arquitetura do modelo e foco em fluxos agentes complexos A IA em questão, conhecida como agente , precisa de contexto amplo, capacidade de navegar por múltiplas decisões, chamar ferramentas, inspecionar resultados e se adaptar continuamente.
O Muse Glimmer 30B foi treinado para sustentar períodos de trabalho mais longos, incluindo fluxos que atravessam várias etapas e sessões distintas.
O modelo gerencia memória entre interações, se recupera de falhas e mantém continuidade mesmo após reinicializações.
Resumo agregado pelo 5News a partir do feed público do veículo. A matéria completa, com todo o contexto, está em www.adrenaline.com.br — o conteúdo pertence a Adrenaline.