Un resoconto pubblicato il 9 ottobre 2026 riferisce che AMD PerfOpt ha prodotto guadagni del 4–12% in diversi benchmark di intelligenza artificiale eseguiti su un Lenovo ThinkPad P14s Gen 4 con AMD Ryzen 7 PRO 7840U e grafica integrata AMD Radeon 780M. Nelle prove con Lemonade, il vantaggio più evidente è stato una minore latenza dei token, accompagnata da un miglioramento più contenuto del throughput. La data di pubblicazione non indica quando si sono svolti i test.
AMD PerfOpt: miglioramenti IA riportati su un Ryzen 7 PRO 7840U
L’intervallo del 4–12% riguarda i vari benchmark IA eseguiti su quella configurazione: non è una percentuale riferita a ogni singolo modello o scenario. I test hanno usato Ubuntu 26.04 LTS e una build del kernel dall’albero Git IOMMU next, prima dell’apertura della finestra di merge di Linux 7.4.
Il risultato su questo portatile amplia il quadro dei test su altre piattaforme Ryzen già trattati da NeoTeo in un precedente aggiornamento.
Lemonade, llama.cpp e i carichi IA testati
Con Lemonade sono stati esaminati gli scenari code-debug, code-short, code-explain e chat-long-output, usando i backend Vulkan e AMD ROCm. I modelli citati nei test comprendono Qwen3-14B-GGUF, Qwen3.5-4B-GGUF, MiniCPM4-8B-GGUF, DeepSeek-Qwen3-8B-GGUF e Qwen3-Coder-Next-GGUF.
La latenza misura il tempo necessario perché arrivi una risposta: nelle prove Lemonade, la riduzione più evidente riguardava il tempo di attesa dei token. Il throughput, cioè il flusso di elaborazione, è migliorato in misura più contenuta. Sono osservazioni qualitative: l’intervallo complessivo del 4–12% non va assegnato a uno specifico modello, backend o scenario.
I test con llama.cpp hanno usato Vulkan e includevano casi di generazione di 128 token e di elaborazione di prompt da 2.048 token. Tra i modelli indicati figurano gpt-oss-20b-Q8_0, Qwen3.5-9B-Q8_0, GLM-4.7-Flash-IQ4_XS e Llama-3.1-Tulu-3-8B-Q8_0.
Il sistema di test e l’attivazione di PerfOpt
Il confronto ha riguardato lo stesso ThinkPad P14s Gen 4, con Ryzen 7 PRO 7840U e Radeon 780M; l’unica impostazione modificata è stata l’attivazione o la disattivazione di PerfOpt. È un elemento utile per leggere il risultato: descrive la differenza osservata su quella macchina e con quei carichi, non una garanzia per tutti i sistemi Ryzen o per ogni attività di IA locale.
PerfOpt è un’ottimizzazione legata all’IOMMU, l’unità che gestisce gli accessi dei dispositivi alla memoria. In modalità identity, gli indirizzi usati dalla GPU per accedere alla memoria corrispondono a quelli di sistema. La proposta riguarda GPU integrate idonee che operano in questa modalità.
Il piano per Linux 7.4 e la proposta IOMMU
L’attivazione predefinita di PerfOpt con Linux 7.4 era descritta come prevista. Il 28 settembre 2026 l’ingegnere AMD Mario Limonciello ha presentato una proposta per attivarla sulle GPU integrate idonee in modalità identity; dopo le osservazioni ricevute, ha detto che avrebbe rivisto la patch. La discussione della proposta ne descrive anche il compromesso: ridurre la latenza DMA, cioè quella dei trasferimenti diretti tra dispositivo e memoria, disattivando per la GPU ATS, PRI, PASID e SVA e rinunciando al contenimento DMA dell’IOMMU previsto in quel percorso.