수치의 전당'…美 의회, 또 다시 막장 드라마

이 기사는 단일 명령어의 성능 하한을 측정하는 'Assembly Hall of Shame' 프로젝트를 소개한다. 현재 챔피언은 x86의 fxrstor64 명령으로, PCIe 대역폭을 포화시켜 62초 동안 198,002,498,236 사이클을 기록했다. 다른 예로는 nop, rdtsc, idiv 등이 있으며, 각각의 사이클 수와 시간이 제시된다.

AI 요약

어셈블리 언어 단일 명령어의 성능 하한선을 탐구하는 'Assembly Hall of Shame' 프로젝트가 공개됐다. x86 부문 챔피언은 fxrstor64 명령어로, PCIe 패브릭의 고지연 MMIO 영역에서 512바이트 상태를 로드하면서 다른 코어들이 동시에 고지연 레지스터를 반복 읽어 PCIe 트래픽을 포화시켜 약 1억 9800만 사이클(62초)의 기록을 달성했다. 이 프로젝트는 성능 최적화가 아닌 '가장 느린 명령어'를 찾는 역발상에서 시작됐다.

핵심 포인트

  • x86 챔피언: fxrstor64 명령어, AMD Ryzen 7 5800H에서 198,002,498,236 사이클(62초) 기록
  • 전략: PCIe 고지연 MMIO 영역에서 512바이트 상태 로드 + 해머 코어들이 동시에 트래픽 포화
  • 규칙: 단일 명령어만 측정, 인터럽트 불가, 공장 기본 설정 유지, rep movs 등 제외
  • 명예로운 언급: vmovdqu를 이용한 SMM(시스템 관리 모드) 설계 붕괴 사례

향후 전망

  • 하드웨어 설계의 병목 지점과 보안 취약점을 이해하는 데 새로운 관점 제공
  • 다른 아키텍처(ARM, RISC-V 등)로의 확장 가능성
출처:Hacker News (GitHub)
Share

이것도 읽어보세요

댓글

이 소식에 대한 의견을 자유롭게 남겨주세요.

댓글 (0)

불러오는 중...