예산별 최고의 LLM, 매일 업데이트

2 hours ago 1

Artificial Analysis Intelligence Index 점수와 API 가격을 비교해, 더 저렴하면서 성능이 같거나 높은 대안이 없는 모델을 가성비 경계선(value frontier) 으로 추림 비용은 입력:출력 토큰 3:1 비율의 100만 토큰당 혼합 가격으로 비교하며, 캐시 입력 할인, 배치 요금, 고속 모드는 반영하지 않음 예산별 추천은 Claude Opus 5.5의 57.6점/$8.00부터 GPT-6 Luna의 37.3점/$0.20까지 6개 모델로 구성됨 기본 화면은 모델별 최고 점수 변형만 남기고 낮은 점수의 모델을 숨기며, 최소 점수 필터는 차트뿐 아니라 가성비 경계선 계산에도 적용됨 데이터를 매일 자동 수집하며, 지수 버전이 바뀌면 점수 기준도 재조정되므로 과거 스냅샷이 아닌 현재 페이지 안에서 비교해야 함 성능과 가격을 함께 비교하는 방식 Artificial Analysis Intelligence Index에 포함된 모델을 혼합 API 가격과 함께 차트에 표시함 가격 축은 로그 척도이며, 점에 마우스를 올리거나 탭 키로 이동하면 세부 정보를 확인할 수 있음 제공된 화면은 최소 점수 30, 모델당 한 행 설정에서 45개 모델을 표시하며, 이 중 6개가 가성비 경계선에 있음 가성비 경계선은 가격 오름차순으로 정렬한 뒤, 더 저렴한 모든 모델보다 점수가 높은 모델만 남겨 계산함 가격이 같으면 점수가 높은 모델을, 점수가 같으면 가격이 낮은 모델을 선택함 경계선 밖의 모델에는 더 저렴하면서 점수가 같거나 높은 대안이 있음 혼합 가격은 100만 토큰당 입력:출력 3:1 비율로 계산함 캐시 입력 할인, 배치 요금, 고속 모드는 포함하지 않음 예산별 추천 모델 예산표는 가성비 경계선을 바탕으로 각 가격 구간의 최고 점수 모델과 차선 후보를 보여줌 $8.00 이상 구간의 추천은 Claude Opus 5.5이며, 57.6점에 혼합 가격은 $8.00임 표의 차선 후보는 Claude Fable 5.1, 53.4점, $20.00임 $2.00 이상 $8.00 미만 구간의 추천은 Muse Spark 1.3이며, 48.1점에 혼합 가격은 $2.00임 표의 차선 후보는 GPT-6 Sol, 47.5점, $4.00임 $0.54 이상 $2.00 미만 구간의 추천은 MiMo-V2.6-Pro이며, 46.3점에 혼합 가격은 $0.54임 표의 차선 후보는 Step 5 Preview, 43.7점, $1.43임 $0.24 이상 ...

Read Entire Article