Qualcomm은 에이전트 실행용 차세대 Hexagon NPU에 트랜스포머 전용 Element Accelerator와 50% 커진 공유 메모리를 적용했다고 공개했습니다. 모델 상태와 중간 결과를 내부에 유지해 외부 DDR 접근을 줄이고, 필요한 전문가만 불러오는 MoE와 INT2부터 FP16까지의 정밀도를 지원합니다. 회사는 INT4 프리필 성능이 최대 50% 개선된다고 설명했습니다. 단일 대형 모델보다 여러 특화 모델의 긴 문맥 처리에 초점을 맞춘 설계로, 이 수치가 모든 앱의 체감 성능 향상을 뜻하는 것은 아닙니다.