퀄컴이 Prism ML과 개발한 1비트 추론 엔진을 소개하며 8비트 모델 1GB를 약 125MB로 줄이는 사례를 제시했습니다. 소형 웨어러블에서 사물 인식 등 AI 작업을 기기 내부에 유지하려는 목적입니다. 운영체제와 메모리 부담을 낮추는 별도 아키텍처도 설명했습니다. 다만 정확도 손실을 최소화한다는 회사 주장 외에 동일 조건의 독립 평가가 제시되지 않아 모든 모델과 전체 실행 메모리가 일률적으로 8분의 1이 된다고 볼 수는 없습니다.
Tech
모델 압축 수치와 전체 기기의 성능 및 정확도는 별도로 평가해야 합니다.
퀄컴이 Prism ML과 개발한 1비트 추론 엔진을 소개하며 8비트 모델 1GB를 약 125MB로 줄이는 사례를 제시했습니다. 소형 웨어러블에서 사물 인식 등 AI 작업을 기기 내부에 유지하려는 목적입니다. 운영체제와 메모리 부담을 낮추는 별도 아키텍처도 설명했습니다. 다만 정확도 손실을 최소화한다는 회사 주장 외에 동일 조건의 독립 평가가 제시되지 않아 모든 모델과 전체 실행 메모리가 일률적으로 8분의 1이 된다고 볼 수는 없습니다.