본 논문은 Symphony를 제안합니다. 이는 GPU와 같은 현재 고성능 아키텍처의 메모리 시스템 비효율성을 해결하도록 설계된 하이브리드 프로그래머블 및 전용 아키텍처입니다. 불필요한 데이터 이동과 거리를 줄이기 위해 메모리 계층 전반에 걸쳐 데이터를 오케스트레이션하는 데 중점을 둡니다.

  • Symphony는 루프라인 부동소수점 연산을 위한 전용 재구성 유닛과 주소 생성, 데이터 필터링 및 희소 메타데이터 처리와 같은 데이터 오케스트레이션 기능을 활용합니다.
  • 프로그래머블 및 전용 작업을 지원하기 위해 연산 리소스는 온칩 메모리 계층 전반에 분산되어 있습니다.
  • 이 아키텍처는 도메인 특화 가속기가 일반적으로 처리할 수 없는 희소 및 밀집 알고리즘의 혼합을 처리하는 것을 목표로 합니다.

Symphony는 희소 텐서 대수에서 프로그래밍 불가능한 ASIC 성능과 동등하며, 동일하게 구성된 GPU 대비 실행 시간 31배 향상 및 에너지 효율 44배 향상을 제공합니다.