Privatemode는 GLM-5.3-Flash의 다음 토큰 확률을 선택지에 대응시켜 추가 학습 없이 구조화된 판단을 만드는 방식을 공개했습니다. 전체 JSON을 생성하지 않고 한 번의 추론으로 확률을 정규화하며 이미지도 입력할 수 있습니다. 자체 비교에서 독일발 요청은 180ms로 Jev의 264ms보다 빨랐지만 미국에서는 순서가 바뀌었습니다. 100만 판단의 비용도 약 62유로로 Jev의 16유로보다 높았습니다. 제공업체의 특정 데이터와 단일 요청 조건에 따른 결과여서 지연, 가격과 실제 업무 정확도를 따로 평가해야 합니다.