PrismML이 Qwen3.8 27B 기반 Ternary Bonsai 2 27B를 Apache 2.0으로 공개했습니다. 세 값의 가중치와 스케일링으로 유효 비트 수를 1.76으로 줄여 모델 크기를 5.9GB로 만들었으며 텍스트와 이미지, 262K 문맥을 지원합니다. 업체는 전체 벤치마크 성능의 98.2%를 유지했다고 밝혔지만 과제별 저하는 다르고 독립 검증 결과는 아닙니다. CUDA와 Apple MLX용 실행 경로가 제공됩니다. 파일 크기만으로 모든 기기의 실행 가능성을 판단하지 말고 캐시와 실제 지연 및 정확도를 함께 확인해야 합니다.
Tech로 돌아가기
Tech
Bonsai 2 27B 공개, 모델 크기 5.9GB로 압축
벤치마크 유지율은 업체 측 집계이며, 긴 문맥과 실제 작업에는 모델 파일 외 메모리도 필요합니다.