paper-data-verifier¶
학술 원고의 통계 수치 정합성 감사 — F-stat / p-value / β / η² / d_z / α / N / % 등을 원본 분석 산출물과 1:1 대조. 통계 검증은 Python 결정론으로 수행하고, M4 paraphrase 의미 일치만 Codex gpt-5.6-terra에 위임
| 항목 | 값 |
|---|---|
| 캐릭터(역할) | 카오루 · Discovery & Insight |
| 모델 | Sonnet 5 · Codex gpt-5.6-terra |
| 도구 (tools) | Read, Glob, Grep, Bash, Write |
| Codex GPT-5.6 위임 | 예 — M4 paraphrase 의미 일치만 위임; 통계 추출·재계산·대조는 Python 결정론 처리 |
무엇을 하는가¶
paper-data-verifier는 작성된 학술 원고 본문에 등장하는 통계 수치(F-통계량, p-값, 회귀계수 β, 효과 크기 η²·d_z, 신뢰도 α, 표본 수 N, 백분율 등)를 추출해 원본 분석 산출물의 ground truth(기준값)와 한 건씩 대조하는 정합성 감사 에이전트다. 통계 추출·재계산·대조는 Python 정규식과 데이터 클래스 기반 결정론 로직으로만 수행하며, Codex gpt-5.6-terra는 M4의 서술형 paraphrase 의미 일치 판단에만 제한적으로 사용한다. 다중 종속 변수의 모호성, 수식어 오인, 신뢰 구간 오해 등 거짓 양성을 차단하는 가드를 갖춰 원고 안의 수치 오기를 안정적으로 짚어낸다.
작동 방식¶
Codex gpt-5.6-terra
입·출력¶
- 입력: 검증 대상 학술 원고, 읽기 전용 원본 CSV, 대조 기준이 되는 통계 산출물(ground truth) 경로
- 출력: 추출된 수치 주장 목록(claims)과 건별 수치 검증 및 paraphrase 의미 일치 결과(verifications) 레코드
- 소비 역할: 레이(분석·지식), 마리(작성), 아스카(품질·검토) 및 PI — 원고의 통계 정합성을 점검할 때 활용
비고¶
2026-05-23 v1.0으로 신설된 카오루 paper-verifier 인프라 중 통계 수치 담당 에이전트다. 동일 시점에 도입된 paper-citation-auditor(인용 정합성)와 짝을 이룬다. 통계 수치 추출·재계산·대조는 전부 Python 결정론으로 처리하고, Codex gpt-5.6-terra는 M4 paraphrase 의미 일치에만 호출하는 설계 원칙을 따른다. 원본 데이터는 읽기 전용으로 강제되어 검증 과정에서 변경되지 않으며, 임계값 미달을 재해석으로 우회하거나 검증 범위를 좁혀 통과시키는 안티패턴을 명시적으로 차단한다.