이 프로젝트에서의 용도#
25~39세 서울·경기 미혼 취업자 합성 레코드를 연령대와 데이터셋 sex로 균형화하고, 목적·시간·권역·피로 조건을 동일하게 교차해 랜딩과 수동 운영 흐름의 예외를 점검한다.
표본과 조건#
공개 API 20,000행에서 조건을 통과한 풀을 만들고 25~29, 30~34, 35~39와 남자·여자 6개 층마다 54명을 UUID 순으로 선택했다. 각 층에 같은 54개 시나리오 조합을 배정했다.
사용할 수 없는 주장#
324라는 수는 실제 고객 표본 크기가 아니다. 시나리오 분포와 퍼널 결과는 실험자가 만든 것이며 수요, 전환율, 연령·성별 차이로 해석할 수 없다. 층별 조건이 동일하므로 결과도 동일하게 설계됐다.
원본 데이터셋의 특성은 Nemotron-Personas-Korea, 파생 결과는 합성 페르소나 MVP 시뮬레이션에서 본다.