Arm이 클라우드와 엣지 및 로봇용 AI 모델과 개발 자원을 모은 AI 포털을 공개했다. 개발자는 사전 최적화한 Qwen과 Gemma 등의 지연, 메모리와 크기를 비교하고 LiteRT 및 ONNX Runtime 기반 예제와 배포 흐름을 볼 수 있다. 최적화 모델은 Hugging Face에서도 제공하며 코딩 에이전트의 MCP 접근 자원은 초기 이용 단계다. 자체 또는 독점 모델을 가져와 분석하고 최적화하는 도구는 향후 계획이다. 실제 성능은 대상 칩과 런타임 및 모델 조건을 맞춰 확인해야 한다.
Tech로 돌아가기
Tech
Arm AI 포털, 기기별 최적화 모델과 배포 예제 통합
지연과 메모리 조건을 비교할 수 있지만 자체 모델 최적화와 에이전트 연동은 제공 단계를 구분해야 한다.