공개 연구 자료 · v1 문제 모음
추론을 뒷받침하는 데이터
512개 고정 문제, 저장된 등급, 하나의 재현 가능한 풀이 경로의 측정치입니다. 내려받아 각 수치의 정의를 살펴보세요.
모집단과 선별
등급별 128개인 고정 v1 모음 전체입니다. 생성기는 시드를 사용한 완성 보드 생성, 순서를 섞은 단서 제거와 유일해 검사, 등급별 할당량을 사용합니다. 완성 보드마다 최대 한 문제를 보존하며 허용되는 최고 등급을 우선합니다. 보수적인 단서 패턴 지문 필터는 모든 스도쿠에 대한 균등 표집이 아닙니다.
플레이어 기록은 없습니다. 계산 경로는 전체 512개 중 512개를 완료했고, 0개는 멈췄으며 0개는 invalid를 반환했습니다. 같은 논리 엔진의 기록된 출력이지 독립적인 수학 인증은 아닙니다.
예제 선정
선택 규칙: 더 많은 단서를 가진 상위 등급 문제가 존재하는 첫 초급 문제를 모음 순서로 고른 뒤, 조건에 맞는 첫 상위 문제를 선택했습니다. 설명을 위한 비교이며 대표 표본은 아닙니다.
필드 사전
- id / puzzle / solution
- 안정적인 공개 ID와 81자리 문자열입니다. puzzle의 0은 빈칸입니다. 스프레드시트에서는 앞의 0을 보존하도록 해당 열을 텍스트로 가져오세요.
- difficulty / hardestTechnique
- 원래 등급 계산 경로에서 사용한 최고 등급 기법에 따른 v1 저장 레이블입니다.
- clues
- 원본 문제에서 0이 아닌 숫자 개수입니다.
- firstEliminationStep
- 첫 유효 후보 제거 단계의 위치로 1부터 셉니다. 채우기만 있는 경로는 CSV에서 빈 값, JSON에서 null입니다.
- emptyAtFirstElimination
- 첫 제거 직전의 빈칸 수이며 남은 풀이 시간이 아닙니다.
- placements
- 기록된 경로에서 숫자를 채운 횟수입니다.
- productiveEliminationPasses
- 제거 규칙을 성공적으로 적용한 횟수입니다. 한 번에 여러 칸-숫자 후보를 지울 수 있습니다.
- explicitCandidateRemovals
- 제거 기법으로 지운 칸-숫자 후보 수입니다. 숫자를 채운 뒤 연결된 칸을 통상 갱신하는 작업은 제외합니다.
- traceStatus
- 현재 경로 계산 결과인 solved, stalled, invalid입니다. 독립적인 증명 검사는 아닙니다.
- recordedSteps (JSON)
- 원래 기법별 집계입니다. 싱글은 채우기 횟수, 다른 기법은 유효 적용 횟수입니다. 이를 더해 사람의 사고 단계 수라고 부르면 안 됩니다.
- examples / hardCase (JSON)
- 선택한 단계의 완전한 전후 값, 논리 후보, 근거 칸, 출발·대상 단위와 정확한 동작입니다. 배열의 칸 인덱스는 0부터, 도표의 r/c 표기는 1부터 시작합니다.
이번 버전 재현하기
Node.js 22.18 이상을 사용하세요. 세 소스 스냅샷을 표시된 경로에 저장한 뒤 프로젝트 폴더에서 내보내기를 실행합니다. 모음을 읽어 연구 자료만 작성하며 고정 모음을 다시 만들거나 덮어쓰지 않습니다.
node --experimental-strip-types scripts/export-research.ts버전과 출처
- 데이터셋
- catalog-v1
- 경로 모델
- v1-first-supported-2026-09-06
- 문제 모음 SHA-256
- 3a075495ccbc8d349ea4ad0f75b3798eab4c37f2bf13fa504adea08f0ef6056a
- 등급 계산기 소스 SHA-256
- ea418c8cb5b38271a2ef1d347a2959bc3cd09e1760c784b9c44e1f6e49cc9655
- 내보내기 소스 SHA-256
- 18fb5b19e95a96d496ef43d68903cca62a37d28657bf66ac37a66287bc274498
풀이기 설정
이 모델에는 체인, 트리플, 피시, 유일성 기반 추론이 없습니다. 기법과 내부 탐색 순서가 고정되어 있습니다. 한 경로의 기법이 모든 경로에 필수는 아닙니다. 등급 할당량이 표본을 편향시키므로 전체 스도쿠의 비율 추정치가 아닙니다.
중앙값은 정렬 후 가운데 값이며, 개수가 짝수면 가운데 두 값의 평균입니다. 집계는 이 모음 전체에 대한 기술 통계입니다. 고정·선별된 모음에 모집단 신뢰구간을 붙이지 않습니다.