UTF-8000은 ASCII와 기존 UTF-8 표현을 포함하면서 임의 크기 정수를 인코딩하려는 독립 제안입니다. 바이트 경계를 구분하는 비트와 길이 표시를 분리하고, 길이 정보가 첫 바이트를 넘으면 후속 바이트로 이어 자기 동기화와 값 순서 정렬을 유지합니다. 여러 바이트 표현에서 데이터는 n바이트당 5n+1비트로, 길이가 늘수록 비율이 62.5%에 수렴합니다. 작성자는 유니코드 협회의 승인이 아닌 실험임을 명시합니다. 현행 RFC 3629의 UTF-8은 1~4바이트만 허용하므로 새 표현을 기존 파서에 그대로 넣을 수는 없습니다.