Supersonic Labs가 1억4430만 매개변수의 Julia 1 가중치를 Apache 2.0으로 공개했다. 문장을 생성하지 않고 문맥과 2~20개 선택지를 받아 분류와 순서 점수, 참거짓 판단을 수행하며 CPU에서도 실행한다. 공개 카드의 선택 평가 정확도는 73.15%였고, 72개 은행 업무 분류에서는 후보 축소를 거쳐 100건 중 64건을 맞혔다. 비교 대상 점수는 같은 조건에서 새로 실행한 결과가 아니며 일부 평가는 표본이 작다. 지식 생성이나 여러 단계 계산의 대체재보다는 업무별 선택 정확도를 검증할 로컬 도구로 보는 것이 적절하다.
Tech로 돌아가기
Tech
Julia 1, CPU에서 선택지를 평가하는 소형 모델 공개
분류와 라우팅을 로컬로 옮길 수 있지만 작은 비교 평가가 범용 추론 성능을 보장하지 않는다.