Qualcomm은 에이전트 실행용 차세대 Hexagon NPU에 트랜스포머 전용 Element Accelerator와 50% 커진 공유 메모리를 적용했다고 공개했습니다. 모델 상태와 중간 결과를 내부에 유지해 외부 DDR 접근을 줄이고, 필요한 전문가만 불러오는 MoE와 INT2부터 FP16까지의 정밀도를 지원합니다. 회사는 INT4 프리필 성능이 최대 50% 개선된다고 설명했습니다. 단일 대형 모델보다 여러 특화 모델의 긴 문맥 처리에 초점을 맞춘 설계로, 이 수치가 모든 앱의 체감 성능 향상을 뜻하는 것은 아닙니다.
Tech로 돌아가기
Tech
Qualcomm 차세대 Hexagon NPU, 공유 메모리 50% 확대
긴 문맥과 여러 모델 실행의 병목을 줄이는 설계지만 실제 단말의 속도와 전력은 별도 검증이 필요합니다.