샤오미, AI 모델 ‘MiMo-V2.6’ 가중치 공개…외부 평가 46점

샤오미가 멀티모달 AI 모델 MiMo-V2.6의 가중치를 공개했다. 독립 평가에서 상위권 점수를 받았지만 훈련 방식의 효과와 실제 업무 성능은 별도로 살펴야 한다.

창가의 책상 위 모니터에 추상적인 색상 격자와 이미지가 표시된 작업 공간. AI 생성 이미지 / 데이마크
창가의 책상 위 모니터에 추상적인 색상 격자와 이미지가 표시된 작업 공간. AI 생성 이미지 / 데이마크. 사진은 기사 이해를 돕기 위한 자료 이미지입니다.

샤오미가 22일 멀티모달 AI 모델 ‘MiMo-V2.6’의 가중치를 공개했다. 개발자가 직접 내려받을 수 있는 모델이며, 외부 평가에서도 높은 점수를 받았지만 훈련 방식의 효과까지 검증된 것은 아니다.

샤오미의 허깅페이스 저장소에는 주력 모델 MiMo-V2.6-Pro-RL의 파일과 모델 설명서가 공개돼 있다. 저장소는 회원 승인이 필요 없는 공개 상태이며 라이선스는 MIT로 표시됐다. 모델 가중치를 공개했다는 뜻이지 학습에 쓰인 모든 데이터가 공개됐다는 뜻은 아니다.

텍스트·이미지·영상·음성 입력

모델 설명서에 따르면 Pro는 텍스트와 이미지, 영상, 음성을 입력받고 최대 100만 토큰의 문맥을 처리하도록 설계됐다. 전체 매개변수는 1조200억 개, 한 번의 추론에 활성화되는 매개변수는 420억 개라고 샤오미는 밝혔다. 이는 실제 이용 환경에서 처리 속도나 정확도를 보장하는 수치가 아니다.

샤오미는 강화학습 과정에서 코딩·에이전트·보안 과제를 섞어 훈련했다고 설명한다. 자사 모델 카드에는 여러 시험 점수가 실렸지만, 훈련 과정의 기여도와 재현성은 외부 평가와 구분해야 한다.

외부 평가 점수 46…용도별 성능은 별도 확인

독립 평가기관 아티피셜 애널리시스는 MiMo-V2.6-Pro에 자체 지능지수 46점을 부여했다. 평가 페이지는 이를 공개 가중치 모델 가운데 상위권으로 분류하면서, 출력 속도는 초당 약 51토큰으로 비교 대상 평균보다 느리고 응답이 다소 길다고 설명했다. 이 지수는 기관이 정한 과제의 종합 결과이며 모든 실무 성능을 대표하지 않는다.

eWeek은 23일 공개된 모델 저장소와 평가 자료를 대조해 Pro·Flash·연구용 90억 매개변수 모델의 용도가 서로 다르다고 보도했다. 특히 외부 시험 결과는 완성 모델의 능력을 살핀 것이지 샤오미가 주장하는 강화학습 설계의 효과를 독립적으로 입증한 것은 아니라고 지적했다.

모델을 직접 운영하려는 개발자는 저장소의 배포 방법과 하드웨어 요구사항을 별도로 확인해야 한다. 공개된 가중치와 MIT 표시만으로 특정 업무의 정확성·보안성·운영비용이 확정되는 것은 아니다.

대표 이미지: AI 생성 이미지 / 데이마크

자료: 샤오미 MiMo 모델 카드(https://huggingface.co/XiaomiMiMo/MiMo-V2.6-Pro-RL), 허깅페이스 모델 API(https://huggingface.co/api/models/XiaomiMiMo/MiMo-V2.6-Pro-RL), 아티피셜 애널리시스(https://artificialanalysis.ai/models/mimo-v2-6-pro), eWeek(https://www.eweek.com/news/xiaomi-mimo-v26-open-source-rl-reproduction/)