Cascade Pipeline for Leading-Order Matrix Element Evaluation on AMD Versal AI Engine Arrays
본 논문은 과정에 대한 선도 차수 행렬 요소를 효율적으로 평가하기 위해 AMD Versal AI 엔진 어레이에 구현된 5 단계 캐스케이드 파이프라인 아키텍처를 제시하며, 단일 CPU 코어 대비 의 속도 향상과 의 에너지 효율성 개선을 달성하면서 백만 분의 일 수준의 수치 정확도를 유지하여 초당 회의 평가에 달하는 예상 처리량을 실현합니다.