OpenJev

55 minutes ago 1

OpenJev는 브라우저의 로컬 모델로 선택지 확률을 직접 읽는 방식과 같은 분포를 JSON으로 생성하는 방식을 실행하고 비교하는 실험임 직접 판독은 제공된 선택지 토큰의 로짓만 정규화하며, 생성 방식은 모델이 추정한 선택지별 확률을 토큰 단위로 출력함 백엔드 없이 실행되며, 모델 가중치는 Hugging Face에서 내려받아 브라우저 캐시에 보관하고 입력은 페이지 밖으로 전송하지 않음 기본 모델은 MiniCPM5 2B이며, 작은 기기용 Qwen3 0.6B와 더 많은 메모리가 필요한 Qwen3.5 4B도 선택할 수 있음 직접 판독 결과는 보정된 신뢰도가 아닌 조건부 확률이며, 실행 시간은 실제로 측정하지만 양자화가 품질과 속도에 영향을 줄 수 있음 두 확률 산출 방식의 로컬 비교 OpenJev GitHub 저장소를 공개했으며, 대기 명단 없이 브라우저에서 직접 사용해 볼 수 있음 두 방식은 같은 로컬 모델에 동일한 상태, 질문, 선택지를 전달함 직접 판독은 디코딩 없이 선택지 로짓을 읽고, 표시된 선택지 토큰에 대해서만 소프트맥스를 계산함 생성 방식은 동일한 선택지 분포를 추정해 선택지와 확률을 담은 JSON 텍스트를 작성하며, 토큰이 도착하는 과정을 보여줌 하나의 GPU를 두 방식이 동시에 점유하지 않도록 직접 판독 후 생성을 순차 실행함 performance.now() 로 설정, 워밍업, 프롬프트 준비, 직접 실행, 첫 생성 토큰, 생성 완료 시간을 측정하며, 미리 준비한 결과는 표시하지 않음 직접 판독 확률은 표시된 선택지 내 조건부 확률임 보정된 신뢰도가 아니며, 모델이 선호할 수 있는 모든 답변을 포함하지 않음 모델 선택과 측정값의 한계 기본값인 MiniCPM5 2B는 데스크톱용이며, 휴대전화나 작은 기기에서는 필요에 따라 Qwen3 0.6B로 전환할 수 있음 Qwen3 0.6B는 크기를 줄이는 대신 정확도를 절충함 Qwen3.5 4B는 훨씬 많은 메모리가 필요하며, 큰 모델은 일부 저사양 기기에서 로딩이 느리거나 메모리 용량을 초과할 수 있음 모델별 다운로드 크기와 표시된 Authored / Perturbed / TypeSafe 결과는 다음과 같음 Qwen3 0.6B는 639 MB이며, 결과는 44.0% / 52.8% / 40.7%임 MiniCPM5 2B는 1.56 GB이며, 결과는 68.6% / 69.3% / 63.7%임 Qwen3.5 4B는 3.01 GB이며, 결과는 81.3% / 76.6% / 8...

Read Entire Article