MiMo-V2.6 — Open omnimodal intelligence, trained in public
MiMo-V2.6 — 공개 훈련 과정을 거친 오픈 옴니모달 모델
Xiaomi가 텍스트·이미지·오디오·비디오를 처리하고 100만 토큰 문맥을 지원하는 MiMo-V2.6 Pro와 Flash를 공개했습니다. 모델 가중치와 기술 보고서뿐 아니라 RL 환경과 훈련 코드도 함께 공개합니다.
- 주제
AI 요약
Xiaomi가 장기 작업을 수행하는 에이전트용 옴니모달 모델군 MiMo-V2.6을 공개했습니다. Pro와 Flash는 텍스트, 이미지, 오디오, 비디오를 처리하며 100만 토큰 문맥을 지원합니다. Xiaomi는 모델 공개와 함께 기술 보고서, 강화학습(RL) 환경, 훈련 코드도 공개한다고 밝혔습니다.
모델과 공개 자료
MiMo-V2.6은 Pro와 Flash 두 모델로 구성됩니다. Product Hunt 댓글 작성자 zaczuo는 두 모델 모두 네이티브 옴니모달 모델이며, 더 빠른 토큰 출력을 원하는 사용자를 위한 UltraSpeed 모드도 있다고 설명합니다. API 가격은 V2.5와 같다고 덧붙였습니다.
같은 댓글에 따르면 Xiaomi는 사후 훈련 초기에 공개 현황판을 만들고 RL 훈련 과정을 실시간으로 스트리밍했습니다. 6일이 채 안 되는 기간에 두 모델이 30회의 RL 단계를 거치는 동안 변화하는 곡선을 볼 수 있었으며, DeepSWE 점수는 Pro가 58.4에서 72.6으로, Flash가 48.8에서 65.7로 올랐다고 합니다. 이 수치는 댓글 작성자가 전한 내용입니다.
공개 범위는 모델 가중치에 그치지 않습니다. Xiaomi는 기술 보고서, RL 환경, 훈련 프레임워크와 훈련에 사용한 경량 하네스도 공개합니다. zaczuo는 Pro가 Artificial Analysis에서 오픈 모델 중 가장 높은 점수를 기록했다고 말하며, 코딩, 컴퓨터 사용, 3D, 창작 작업 등에서도 성능을 보인다고 덧붙였습니다.
Product Hunt 반응
- @zaczuo — 안녕하세요! MiMo-V2.6은 Pro와 Flash로 제공되며, 둘 다 네이티브 옴니 모델입니다. 토큰을 더 빨리 받고 싶을 때는 UltraSpeed 모드를 쓸 수 있습니다. API 가격은 V2.5와 같습니다. 사후 훈련 초기에 공개 현황판을 올리고, 보고 싶은 누구나 RL 훈련 과정을 실시간으로 볼 수 있게 했습니다. 모델 연구소가 이런 일을 공개적으로 하는 모습은 제가 본 적이 없습니다. 6일도 안 되는 동안 두 모델이 30회의 RL 단계를 거치며 점수가 변하는 모습을 직접 볼 수 있었습니다. DeepSWE에서 Pro는 58.4점에서 72.6점으로, Flash는 48.8점에서 65.7점으로 올랐습니다. 공개 자료도 체크포인트에 그치지 않습니다. Xiaomi는 가중치, 기술 보고서, RL 환경, 훈련 프레임워크와 주변에서 사용한 경량 하네스까지 오픈소스로 공개합니다. Pro는 현재 Artificial Analysis에서 오픈 모델 가운데 가장 높은 점수를 기록하고 있으며, 같은 모델군은 코딩, 컴퓨터 사용, 3D, 창작 작업에서도 폭넓은 성능을 보이고 있습니다.
- @a_r48 — 완전히 동의합니다! 공개한 기술 보고서와 코드에서 얻을 수 있는 정보가 정말 많습니다. 말씀하신 것처럼, 최첨단 모델 직원들이 트위터에 가끔 단편적인 정보를 올릴 뿐인 폐쇄적이고 불투명한 방식과 뚜렷한 대조를 이룹니다.
- @german_merlo1 — 👏🏻 👏🏻 👏🏻 👏🏻 👏🏻
원문: Product Hunt / 번역·요약: Trawling