TL;DR

  • AMD의 PerfOpt가 Linux 7.4에서 Radeon 내장 GPU의 시스템 메모리 접근 시 IOMMU 오버헤드를 우회해 AI·LLM 성능을 최대 18~23% 높이는 기능임.
  • PerfOpt는 AMD I/O 가상화 기술(IOMMU) 사양에 포함된 AMD IOMMU 성능 최적화 기능임.
  • Linux 7.4 패치가 적용되면 AMDGPU 드라이버가 내장 GPU에서 PerfOpt를 기본 활성화하며, 커널 모듈 옵션으로 비활성화 가능함.
  • 성능 비교는 같은 테스트 커널에서 PerfOpt 활성화와 비활성화를 비교했으며, Strix Halo 데스크톱, Strix Point 노트북, Krackan 노트북을 사용함.
  • 테스트에는 Lemonade 로컬 AI 서버와 Llama.cpp 백엔드를 사용했으며, Linux 7.4 개발 주기는 10월 하순 시작 예정이고 안정 버전은 연말 무렵 출시될 전망임.

개요

  • AMD Ryzen 노트북이나 데스크톱의 Radeon 내장 그래픽으로 AI·대형 언어 모델(LLM)을 실행하는 경우, 특히 저사양 하드웨어에서 Linux 7.4의 성능 향상이 두드러질 전망임.
  • Linux 7.4 병합 기간이 10월 하순 열리기 전, AMD 내장 그래픽 시스템에서 새 PerfOpt 기능을 활성화하는 패치가 IOMMU 하위 시스템의 Git 트리에 반영됨.
  • AMD PerfOpt는 AMD I/O 가상화 기술(IOMMU) 사양에 포함된 성능 최적화 기능이며, 시스템 메모리에 직접 접근할 때 IOMMU를 우회해 오버헤드를 피하는 방식임.
  • 패치가 Linux 7.4에 포함되면 내장 GPU 시스템에서 PerfOpt가 자동으로 활성화되며, amdgpu.iommu_perfopt=0 커널 모듈 옵션으로 강제 비활성화해 성능 영향을 비교할 수 있음.

테스트 방법

  • Linux 7.4에 포함될 코드가 들어 있는 IOMMU Git 트리에서 테스트 커널을 빌드하고, 동일한 커널에서 PerfOpt 기본 활성화 상태와 비활성화 상태를 비교함.
  • Strix Halo 노트북을 사용할 수 없어 Strix Halo 데스크톱에서 테스트를 진행했으며, 성능 영향을 폭넓게 확인하기 위해 Strix Point 및 Krackan 노트북도 테스트에 포함함.
  • AMD Ryzen AI 시스템에서 로컬 AI·LLM 추론을 수행하기 위해 Llama.cpp 백엔드를 사용하는 Lemonade 로컬 AI 서버를 활용함.

후속 일정

  • Linux 7.4 전체 커널 성능을 살펴보는 과정에서 AMD PerfOpt 벤치마크를 추가로 공개할 예정임.
  • Linux 7.4 개발 주기는 10월 하순 시작 예정이며, 안정 커널은 연말 무렵 출시될 전망임.
  • Linux 7.4가 해당 연도의 LTS 커널 버전이 될 가능성도 상당함.