AMD PerfOpt doit intégrer Linux 7.4 pour réduire la traduction d’adresses de l’IOMMU lors de certains accès mémoire des GPU intégrés. Les essais publiés le 29 septembre 2026 rapportent des gains variables : typiquement 2 à 4 % sur un système Strix Halo, jusqu’à 23 % sur un portable Strix Point, et des améliorations non chiffrées sur un portable Krackan Point.
Ce qu’AMD PerfOpt change dans Linux 7.4
À la fin septembre 2026, le noyau Linux 7.4 était encore en préparation et sa sortie stable était attendue vers la fin de l’année. AMDGPU est prévu pour activer PerfOpt par défaut sur les configurations AMD à GPU intégré concernées.
La fonction doit s’appliquer lorsque le GPU intégré fonctionne déjà en mode d’identité. Le paramètre amdgpu.iommu_perfopt=0 permet de la désactiver.
Comment PerfOpt modifie l’accès mémoire de l’IOMMU
Une IOMMU — unité de gestion mémoire des entrées-sorties — traduit les adresses utilisées par un périphérique pour accéder à la mémoire système. Dans le cas décrit, PerfOpt doit permettre à certains GPU intégrés privilégiés de contourner cette traduction lorsqu’ils accèdent directement à cette mémoire. L’IOMMU conserve toutefois le contrôle des autorisations de lecture et d’écriture.
La fonction porte sur les GPU intégrés éligibles, et non sur les cartes graphiques dédiées. Ce n’est pas un accélérateur d’IA distinct : l’optimisation concerne le chemin d’accès mémoire du GPU.
Les résultats rapportés sur trois systèmes
Les essais publiés le 29 septembre 2026 comparaient PerfOpt activé et désactivé sur un même noyau de test issu de l’arbre de développement IOMMU. Le scénario portait sur l’inférence locale avec Lemonade et son backend llama.cpp. Les résultats variaient selon le système testé.
| Système testé | Résultat rapporté |
| Framework Desktop avec AMD Ryzen AI Max+ 395, Strix Halo et 64 Go de LPDDR5-8000 | Gains typiques de 2 à 4 % |
| ASUS Zenbook S16 avec AMD Ryzen AI 9 365, Strix Point et 16 Go de LPDDR5-7500 | Gains allant jusqu’à 23 % |
| Ordinateur portable avec AMD Ryzen AI 5 340, Krackan Point | Gains qualitatifs et baisse du délai avant le premier jeton généré |
Les résultats sur Strix Halo sont des gains typiques pour cette configuration. Les 23 % relevés sur Strix Point correspondent au maximum rapporté, pas à une moyenne. Sur Krackan Point, les résultats publiés décrivent une amélioration et un délai plus court avant le premier jeton, sans chiffrer le gain.
Ce que ces essais disent des autres machines
Les tests portaient sur de l’inférence locale et sur trois systèmes précis. Ils ne permettent pas d’étendre ces chiffres à tous les GPU Radeon intégrés ou à d’autres charges de travail. La portée annoncée de PerfOpt reste celle des GPU intégrés éligibles, tandis que les résultats mesurés dépendent du système testé.