Um relatório de benchmarks publicado em 9 de outubro de 2026 atribuiu ao AMD PerfOpt ganhos de 4% a 12% em várias cargas de IA executadas em um Lenovo ThinkPad P14s Gen 4 com AMD Ryzen 7 PRO 7840U e AMD Radeon 780M. No Lemonade, a melhora mais perceptível foi na latência dos tokens; o throughput — a quantidade de dados processada em determinado período — também avançou, mas em menor medida.

Ganhos relatados em várias cargas de IA

A faixa de 4% a 12% resume os resultados relatados para diferentes benchmarks nesse ThinkPad. Ela não corresponde a um modelo ou cenário específico: o texto dos resultados não detalha um percentual para cada gráfico, modelo ou backend.

No servidor de IA local Lemonade, as cargas incluíram code-debug, code-short, code-explain e chat-long-output. Os testes usaram os backends Vulkan e AMD ROCm, com modelos como Qwen3-14B-GGUF, Qwen3.5-4B-GGUF, MiniCPM4-8B-GGUF, DeepSeek-Qwen3-8B-GGUF e Qwen3-Coder-Next-GGUF.

Também foram relatadas melhorias em testes de geração de tokens e processamento de prompts no llama.cpp com Vulkan. Entre os casos estavam geração com 128 tokens e processamento de prompts com 2.048 tokens, em modelos selecionados como gpt-oss-20b-Q8_0, Qwen3.5-9B-Q8_0, GLM-4.7-Flash-IQ4_XS e Llama-3.1-Tulu-3-8B-Q8_0.

O sistema usado nos testes

A configuração reunia um Lenovo ThinkPad P14s Gen 4, processador AMD Ryzen 7 PRO 7840U e gráficos integrados AMD Radeon 780M. O sistema operacional era Ubuntu 26.04 LTS, com uma compilação do kernel baseada na árvore Git IOMMU next, anterior à abertura da janela de integração do Linux 7.4.

A comparação alternou o PerfOpt, sem outras mudanças de configuração do sistema, segundo o relato dos testes. O recurso é uma otimização relacionada ao IOMMU, unidade que controla o acesso de dispositivos à memória. Com GPUs integradas compatíveis, o PerfOpt busca reduzir a sobrecarga associada ao acesso à memória do sistema.

O plano para Linux 7.4 e a proposta da AMD

A ativação padrão do PerfOpt no Linux 7.4 foi descrita como um plano. Em 28 de setembro, o engenheiro da AMD Mario Limonciello propôs habilitar a otimização para GPUs integradas elegíveis no modo de identidade, em que o mapeamento de endereços do dispositivo é feito de forma correspondente aos endereços da memória. Depois de receber questionamentos sobre o desenho da mudança, Limonciello disse que revisaria a proposta.

A implementação proposta troca recursos: a documentação do patch descreve menor latência de DMA, mas também a desativação, para a GPU, de ATS, PRI, PASID e SVA, além da redução da contenção de DMA fornecida pelo IOMMU. Esses detalhes fazem parte da proposta para o modo de identidade, não de uma descrição geral de todos os sistemas com Ryzen.

A NeoTeo já publicou um acompanhamento sobre a proposta do AMD PerfOpt para GPUs integradas no Linux 7.4. A discussão técnica do patch descreve o escopo e as mudanças sugeridas.