Dream-RSI 연구는 코딩 에이전트와 평가기를 바꾸지 않고 분기 선택과 병렬 실행, 중단 시점을 정하는 탐색 코드를 개선합니다. 이미 실행한 탐색 트리의 결과를 재생해 후보 전략을 저렴하게 비교한 뒤 온라인 탐색에 다시 적용하는 방식입니다. 알고리즘과 수학 최적화, GPU 커널 과제에서 일부 비용 절감을 보고했지만 기록에 없는 선택의 결과까지 예측하는 것은 아닙니다. 공개 저장소도 전체 코드와 재현 스크립트를 준비 중이라고 밝혀 즉시 재현 가능한 완제품과 구분해야 합니다.