LG유플러스가 옵트AI와 추론 구조를 최적화해 같은 GPU 자원에서 처리하는 토큰을 늘리는 공동 연구를 진행한다고 밝혔다. 초기 적용에서 GPU 효율이 최대 4배 높아졌다는 회사 설명이 제시됐지만 비교 모델, 작업 부하와 상세 측정 조건은 공개되지 않았다. 따라서 모든 서비스의 처리량이 이미 4배가 됐다는 의미는 아니다. 앞서 공개한 NPU 기반 모델의 전력 및 크기 절감 수치와도 별개인 결과이므로 실제 도입 시 자체 부하로 비용과 응답 품질을 함께 확인해야 한다.