AMD ROCm 7.0 desafia CUDA com suporte nativo a Llama 4
A AMD revelou ontem o ROCm 7.0, a maior atualização da sua plataforma de computação GPU desde a aquisição da Xilinx. O foco declarado é simples: fechar a lacuna com o CUDA da NVIDIA no segmento de treinamento de modelos de linguagem.
O destaque técnico é um compilador Llama-aware que reconhece padrões específicos da arquitetura do Llama 4 e gera código otimizado sem intervenção manual. Em benchmarks preliminares com Llama 4 70B, o ROCm 7.0 entrega 40% menos tempo de fine-tuning comparado à versão 6.x, ainda em GPUs MI300X.
A AMD também anunciou parcerias com Hugging Face, Together AI e Anyscale para garantir que os frameworks mais populares (vLLM, SGLang, TGI) tenham suporte first-class no lançamento.
A maior barreira histórica do ROCm — fragmentação entre modelos de GPU e necessidade de patches manuais — está sendo atacada com um novo driver unificado que abrange desde MI100 até as próximas MI400. Para o ecossistema open-source, isso significa menos "AMD does not work with X" no GitHub.
Ainda não é hora de aposentar o CUDA, mas a convergência está visível.