다음 단계 노트북을 생성합니다. "다음 단계 만들어줘" 요청 시 사용.
reports/pipeline_context.json → current_step 확인| current_step | 생성할 파일 | 참조 |
|---|---|---|
preprocess |
02_preprocessing.ipynb | preprocessing_guide.md |
viz |
03_visualization.ipynb | step2 결과 |
state_analysis |
04_state_analysis.ipynb | stats.md |
writing |
step5_draft_method.md, step5_draft_results.md | writing.md |
proofreading |
step6_proofreading_report.md | proofreading_guide.md |
revision |
step7_revised_method.md, step7_revised_results.md | revision.md |
guides/preprocessing_guide.md (점수 계산 공식)reports/step2_preprocess.json (계산된 척도 목록)guides/stats.md (Critical Ratios 방법론)guides/writing.md (JSON 경로 매핑, 글쓰기 원칙)reports/step5_draft_method.mdreports/step5_draft_results.md%pip install (필요한 패키지)Ideology, H-H 계산 시 z-score를 DataFrame에 할당할 때 반드시 index를 유지해야 합니다.
# ❌ 잘못된 방법 (NaN 전체 발생)
z_mpqtr = stats.zscore(scores['MPQ_Traditionalism'].values)
scores['Ideology'] = (z_mpqtr + z_neo_lib * -1) / 2
# ✅ 올바른 방법 (pd.Series로 index 유지)
valid_mask = scores['MPQ_Traditionalism'].notna() & scores['NEO_Liberalism'].notna()
mpqtr_valid = scores.loc[valid_mask, 'MPQ_Traditionalism']
z_mpqtr = pd.Series(stats.zscore(mpqtr_valid.values), index=mpqtr_valid.index)
Big Five 컬럼은 약어 사용: NEO_O, NEO_C, NEO_E, NEO_A, NEO_N
NEO_Openness → KeyError 발생NEO_O이전 노트북 수정 후 다음 노트북을 확인할 때는 커널을 재시작해야 합니다.
step1~step4 JSON 파일이 모두 존재해야 writing step 실행 가능.
guides/proofreading_guide.md (평가 기준, Few-shot 예시, 템플릿)reports/step5_draft_method.md (평가 대상)reports/step5_draft_results.md (평가 대상)reports/step6_proofreading_report.mdreports/step5_draft_method.md (원본 Method 초안)reports/step5_draft_results.md (원본 Results 초안)reports/step6_proofreading_report.md (프루프리딩 평가 및 수정 사항)reports/step7_revised_method.mdreports/step7_revised_results.md