Arm이 클라우드와 엣지 및 로봇용 AI 모델과 개발 자원을 모은 AI 포털을 공개했다. 개발자는 사전 최적화한 Qwen과 Gemma 등의 지연, 메모리와 크기를 비교하고 LiteRT 및 ONNX Runtime 기반 예제와 배포 흐름을 볼 수 있다. 최적화 모델은 Hugging Face에서도 제공하며 코딩 에이전트의 MCP 접근 자원은 초기 이용 단계다. 자체 또는 독점 모델을 가져와 분석하고 최적화하는 도구는 향후 계획이다. 실제 성능은 대상 칩과 런타임 및 모델 조건을 맞춰 확인해야 한다.