arxiv-wiki

Para-Pipe: Exploiting Hierarchical Operator Parallelism of ML Computational Graphs on SoCs

← 2026-09-05 목록으로 돌아가기

한 문장 요약

Para-Pipe는 ML 연산 그래프의 계층적 연산자 병렬성(intra-/inter-stage)을 파이프라인과 결합해 이종 SoC에서 지연과 처리량 간의 균형을 조절하고 통신 비용을 줄여 에너지 효율을 개선하는 정적 매핑·스케줄링 프레임워크이다.

해결하려는 문제

기존 파이프라이닝 기법은 스트리밍 처리 시 처리량을 높이나, 현대의 복잡한 신경망(예: Inception 계열, Transformer 계열)은 연산자 간 병렬성이 풍부하고 분기·fan-in 구조가 많아 단순 파이프라인 분할만으로는 프레임 당 지연(latency)이 증가하고 프로세서 간 통신 비용이 커진다. 반대로 모든 유닛을 동원해 단일 프레임 지연을 최소화하는 병렬 실행은 파이프라인이 제공하는 처리량(throughput)을 희생한다. 따라서 복잡한 그래프 구조와 이종 SoC 자원을 고려해 지연·처리량·에너지 효율의 균형을 맞추는 매핑·스케줄링 방법이 필요하다.

핵심 기여

접근 방법

주요 결과

한계

개발자 관점

근거 범위: 이 분석은 제공된 논문 PDF 본문 텍스트를 근거로 작성되었음. 주요 수치(예: 성능·에너지 개선율, 비용 추정 오차, ILP 해결 시간 등)는 본문과 표/그림에서 직접 추출하였음. 다만 PDF 내 일부 도식·숫자 표기가 잘리거나 요약된 문맥(그림 캡션의 세부값 등)이 있어, 해당 부분은 본문에 명시된 수치 위주로 기술했음을 밝힘.