샤오미 MiMo-V2.6-Pro, 성능과 API 비용 분석

4 days ago 13

샤오미의 오픈 웨이트 추론 모델 MiMo-V2.6-Pro가 AAII 46점을 기록해 비슷한 크기의 공개 모델 비교군 중앙값인 18점을 크게 웃돎 전체 1조 개 중 토큰당 420억 개 파라미터를 활성화하는 MoE 구조이며, MIT 라이선스로 가중치를 공개해 상업적 사용과 자체 호스팅이 가능함 텍스트뿐 아니라 이미지, 음성, 영상을 입력받아 텍스트로 답하며, 100만 토큰 컨텍스트를 지원함 Xiaomi API 가격은 100만 토큰당 입력 0.435달러, 출력 0.87달러이며, 캐시 적중 입력에는 99% 할인이 적용됨 AA 측정에서 출력 속도는 초당 57.9토큰으로 비교군 중앙값 67.7토큰보다 낮았으며, 지능 지수 평가의 과제당 가중 평균 비용은 0.13달러였음 모델 구조와 공개 조건 MiMo-V2.6-Pro는 샤오미가 개발한 추론 모델로, 답변을 생성하기 전에 사고 과정을 거쳐 복잡한 문제를 처리함 전체 파라미터 1조 개, 활성 파라미터 420억 개의 전문가 혼합(MoE) 구조 토큰마다 일부 전문가만 선택해 계산하므로, 전체 파라미터를 매번 모두 사용하는 방식과 다름 텍스트, 이미지, 음성, 영상을 입력받고 텍스트로 결과를 출력함 100만 토큰 컨텍스트를 지원해 긴 문서와 대화 등을 입력으로 다룰 수 있음 모델 가중치는 MIT 라이선스로 공개돼 상업적 사용과 자체 호스팅이 가능함 Xiaomi API로도 이용할 수 있으며, 제공업체 비교 페이지에서 가격과 측정 성능을 확인할 수 있음 Artificial Analysis 평가 결과 Intelligence Index 46점을 기록해 비슷한 크기의 공개 가중치 모델 비교군 중앙값인 18점보다 높음 이 중앙값은 해당 비교군 기준이며, 모든 최신 모델이나 비공개 모델을 포함한 전체 중앙값은 아님 Intelligence Index v4.3.2는 실제 업무, 코딩, 지식, 과학과 긴 문맥 처리 능력을 10개 평가로 종합함 업무와 에이전트: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA로 지식 업무, 실제 업무 과제와 SaaS 작업을 평가 코딩과 터미널 사용: Terminal-Bench 4.0, SciCode 지식과 과학 추론: Humanity’s Last Exam, CritPt, AA-Omniscience 문서와 긴 문맥 추론: GDP.pdf, AA-LCR v1.1 평가는 Artificial Analysis가 독립적으로 수행하며...

Read Entire Article