Mercury 2.5 LLM, 초당 770토큰 달성

7 hours ago 3

Mercury 2.5는 Inception API 기준 초당 780.8토큰을 출력하며, 비슷한 가격대 추론 모델의 중앙값인 111.9토큰/초를 크게 웃돎 Artificial Analysis Intelligence Index는 12점으로 비교 대상 중앙값 13점보다 낮으며, 빠른 출력 속도와 지능 평가 결과에는 차이가 있음 가격은 100만 입력 토큰당 0.25달러, 출력 토큰당 0.75달러이며, Intelligence Index 평가의 과제당 가중 평균 비용은 0.06달러임 출력 속도는 빠르지만 첫 토큰까지 걸리는 시간은 3.06초로 비교 대상 중앙값 2.20초보다 김 텍스트 전용 추론 모델로 26만 토큰의 컨텍스트 창을 지원하며, 모델 가중치와 파라미터 수는 공개하지 않음 모델 특성과 지원 범위 Mercury 2.5는 Inception이 개발한 독점 모델로, 2026년 9월 8일 출시됨 모델 가중치는 공개되지 않았으며, 모델 크기와 파라미터 수도 비공개임 API 제공업체는 1곳이며, 제공업체 비교 페이지에서 가격과 제공 현황을 확인할 수 있음 평가 대상은 추론 버전으로, 답변 전에 확장된 사고 또는 사고 사슬 추론으로 복잡한 문제를 풀어감 비추론 변형도 존재할 수 있음 텍스트 입력과 출력만 지원하며, 이미지 입력과 멀티모달 기능은 지원하지 않음 컨텍스트 창은 26만 토큰으로, Arial 12포인트 기준 A4 약 390페이지에 해당함 컨텍스트 창은 입력과 출력을 합친 최대 토큰 수이며, 출력 토큰 한도는 일반적으로 이보다 훨씬 낮고 모델마다 다름 큰 컨텍스트 창은 대량의 데이터를 검색하고 추론하는 RAG 워크플로에 관련됨 지능 평가 결과와 비교 기준 Artificial Analysis Intelligence Index는 12점으로, 비슷한 가격대 추론 모델의 중앙값 13점보다 낮음 같은 가격대 모델과 비교하면 지능은 평균 이하이지만, 가격 경쟁력이 있고 출력은 빠르고 비교적 간결함 비교 집단은 추론 여부, 가중치 공개 여부, 크기와 가격대에 따라 달라짐 비추론 모델은 다른 비추론 모델과만 비교하고, 추론 모델은 추론 및 비추론 모델 모두와 비교함 공개 가중치 모델은 같은 크기 구간의 공개 가중치 모델과만 비교함: Tiny는 4B 이하, Small은 4B~40B, Medium은 40B~150B, Large는 150B 초과임 독점 모델은 입력/출력 가격을 3:1로 혼합해 같은 가격대의 독점 및 공개 가중치 모델과 비교...

Read Entire Article