청년의 취업준비 특성 기반 차년도 취업 여부 예측 프로젝트 (청년패널2021). 논문 리딩 → 기획 → 구현으로 진행 중인 팀 레포. 주제·데이터는 2026-08-09 확정.
현재 상태와 확정된 결정은 plan/README.md가 항상 최신이다.
설치부터 차근차근 필요하면 온보딩.md를 보면 된다 (15분 코스). 요약:
git clone https://github.com/khuda-data/10th-toy-team1.git- 터미널 AI(Claude Code / Gemini CLI / Codex CLI) 실행 → "이 레포의 작업 원칙을 요약해봐" 라고 물어
AGENTS.md가 로드됐는지 확인 - 작업 → 끝나면
작업기록/에 세션 로그를 남기고 push
규칙 전문은 AGENTS.md 하나만 보면 된다 (CLAUDE.md·GEMINI.md는 포인터).
유지 규칙: 새 폴더·중요 산출물을 만들면 그 커밋에서 이 표에 한 줄 추가한다. AI가 자동으로 하게 되어 있다 (
AGENTS.md§10).
| 경로 | 무엇 | 언제 보나 |
|---|---|---|
온보딩.md |
새 팀원 시작 안내 — 설치부터 첫 세션까지 15분 코스 | 처음 합류했을 때 |
회의기록/20260805-팀장지침.md |
팀장의 진행 방향 안내 — 회의 기록·주제 구체화·깃허브 기록 원칙 | 합류 직후 · 뭘 해야 할지 궁금할 때 |
회의기록/20260808-프로젝트-주제-재검토.md |
구직자 취업 적합성 판단 메인 후보 선정 회의록 — 결정·액션 아이템·이월 안건 | 8월 8일 회의 결과를 확인할 때 |
회의기록/20260813-전처리-모델링-역할분담.md |
희망직군 6개 전처리·Global/Local 모델 역할 분담과 8월 일정 | 8월 13일 회의 결과를 확인할 때 |
회의기록/20260816-데이터셋-구간-결측치-피처엔지니어링.md |
단일 데이터셋 구간·과거 응답 결측 보완·42개 Feature·Local 6개 생성 결정 | 8월 16일 회의 결과를 확인할 때 |
AI활용팁.md |
AI 지시 요령 + 도구별 기능 + 팀 슬래시 명령(/wrap 등) |
AI를 더 잘 쓰고 싶을 때 |
활용설명서.md |
환경 사용법 통독형 설명서 — 개념·세팅·하루 흐름·실전 시나리오 7·폴더·규칙·협업·에러 처방·프롬프트 | 처음부터 읽으면 환경 전체가 이해된다 |
.claude/commands/ |
팀 공용 슬래시 명령 (md 1개 = 명령 1개, 커밋하면 팀 공유) | 반복 작업을 명령으로 만들 때 |
업데이트.md |
팀 업데이트 알림 — 누가 뭘 올렸는지 요약. git pull 하면 새 항목이 터미널에 자동으로 뜬다 |
풀 받은 직후 |
AGENTS.md |
AI 작업 원칙 (단일 소스) — git 루틴·금지 목록·문서/디자인 규칙·산출물 스타일·Windows 팁 | 터미널 AI를 쓰는 모든 세션 |
CLAUDE.md / GEMINI.md |
AGENTS.md를 가리키는 포인터 | 직접 볼 일 없음 |
plan/README.md |
프로젝트 메타 + 상태 스냅샷 + Phase 로그 | 프로젝트 현황이 궁금할 때 (여기부터) |
plan/CHANGELOG.md |
날짜순 작업 로그 (만든 것·정한 것·막힌 것) | 언제 무엇이 결정됐는지 찾을 때 |
plan/details/01-overview.md |
확정/미확정 목록 + 주제 후보 + 열린 질문 | 주제·범위 논의 전 |
plan/details/02-한국어해설-작성지침.md |
논문 한국어 해설 제작 파이프라인 | 논문 해설을 만들 때 |
plan/details/03-논문인덱스.md |
읽은 논문 인덱스 (한 줄 요약 + 태그) | 어떤 논문을 읽었는지 찾을 때 |
plan/details/04-구현계획-20260729.md |
안전 경로 시스템 설계 초안 v0.1 (XGBoost 배치 + 회랑 A*) | 구현 착수 전 필독 |
plan/details/05-협업-통합절차.md |
여러 명의 결과물을 합치는 4단계 (뼈대→약속→분담→작은 PR) | 협업 작업 시작 전 |
plan/details/06-인터페이스.md |
YP2021 Person-Period·Global/Local·결과 파일 계약 — 살아있는 인터페이스 정본 | 공용 코드·데이터 만들기 전 |
design/DESIGN-apple.md |
앱·PPT·대시보드 등 모든 시각 산출물의 디자인 토큰 | 눈에 보이는 것을 만들 때 (예외 없음) |
design/DESIGN-notion.md |
논문 해설 HTML 전용 디자인 토큰 | 해설 문서를 만들 때만 |
논문/ |
논문 1편 = 전용 폴더 1개 (원본 PDF + md 변환본 + README + assets). 취업불안 관련 4편 추가 (JobStressScale_Kim_2023 ⭐실험 사용 척도 · JobAnxietyScale_Cho_2008 · SpecCompetition_Heo_2020 · Uncertainty_SocialComparison_2025) |
선행연구를 읽을 때 |
plan/details/07-연구설계-선행연구맵.md |
취업 스트레스 연구의 절별 선행연구 + 실험 설계 + 척도 문항 | 발표에서 "왜 이 문제인가"를 쓸 때 |
plan/details/08-기획서-20260811.md |
제출 기획서 — 주제·데이터(청년패널2021)·모델·타임라인 확정본 | 우리가 뭘 하기로 했는지 확인할 때 |
plan/details/09-나호열-프로젝트계획.md |
★ 팀원용 설명 문서 — 왜 이 문제인지, 어떻게 검증하는지 + 인용 원문 발췌(부록 A) + 설문 문항(부록 B) | 프로젝트의 논리를 이해할 때 · 발표 준비할 때 |
plan/details/10-YP2021-직군별-취업예측-계획.md |
YP2021 기반 Global/직군별 Local 모델 계획과 공식 자료 링크, 다음 회의 안건 | 데이터 전처리·모델링을 시작하기 전 |
plan/details/11-YP2021-공통-전처리-모델링-프로토콜.md |
공통 전처리·모델링 프로토콜 v1.3 — 기준연도 미취업자 전체 대상·Feature·분할·모델·평가의 고정 기준 | 구현·실험 전 |
plan/details/12-Global-피처엔지니어링-요약.md |
Global 모델 feature 31개 구현 코드 요약 — 뭘 만들었고, 확인 필요한 판단 지점이 뭔지 | 피처 엔지니어링 코드 리뷰할 때 |
plan/details/13-YP2021-PersonPeriod-전처리-설계안.md |
Person-Period 3개 구간, 42개 Feature 그룹, 결측·과거 이력 처리 설계 | 전처리 구현·코드북 대조 전 |
plan/details/14-Global-모델링-단계별-실행흐름.md |
Global 모델 단계별 운영 절차 — LR/XGBoost 1차·Feature 선택·2차·최종 Test 사이의 사람 판단 경계 | Global 모델링을 시작하거나 다음 단계로 넘기기 전 |
설문/ |
실험용 설문지 — 취업 스트레스 척도 22문항 (배포용 hwp + 설명 md) + 원본 IRB 양식 | 사전·사후 설문을 돌리기 전 |
검색기록/ |
모든 검색의 기록 — 논문·데이터·라이브러리·기술, 검색어·후보·채택/제외 이유 (AI 자동 작성) | 무언가 찾기 전(중복 확인)·찾을 때 |
작업기록/ |
AI 세션 로그 — 지침·답변·검증의 시간순 이력 (사람별 폴더) | 세션 시작 전(이어받기)·종료 시(기록) |
회의기록/안건.md |
안건함 — 막힌 것·팀이 정할 것을 즉시 추가 | 막혔을 때·논의거리가 생겼을 때 |
회의기록/ |
회의록 (회의 1번 = 파일 1개, 결정·액션 아이템) | 회의 후·지난 결정을 찾을 때 |
scripts/ |
유틸 스크립트 + git 훅 3종 — 커밋 시 작업기록 점검, 푸시 시 업데이트 요약 점검, 풀 받으면 팀 업데이트 자동 안내 | 해설 그림 작업·최초 세팅 시 |
code/ |
YP2021 통합 코드 — pipeline/·preprocess/·model/·evaluation/·config/ 공통 뼈대 |
코드 작업 전 (code/README.md 먼저) |
data/raw/ |
원본 데이터 — 수정 금지, 출처 기록 필수 | 데이터를 받아올 때 |
data/result/ |
팀 공용·최종 결과물 (통합 코드가 만든 것만) | 합의된 최종 산출물을 저장할 때 |
notebooks/ |
공용 code/ 모듈을 실행해 표·그래프로 확인하는 Jupyter Notebook |
Global 모델링 단계별 결과를 확인할 때 |
plan/reports/ |
사람이 작성·검토한 단계별 결과 보고서 | 모델링 판단과 재현용 결과를 함께 확인할 때 |
notebooks/global/02_feature_selection.ipynb |
Global Stage 2 Train 내부 Feature 분석 — CV Permutation Importance·계수/gain·상관·VIF·종합표 | Stage 1 결과를 확인하고 사람이 2차 Feature 후보를 결정할 때 |
notebooks/global/03_second_model.ipynb |
Global Stage 3 — 사람이 확정한 25개 Feature로 LR/XGBoost 재튜닝 및 1차/2차 Train CV·OOF 비교 | Feature 선택 뒤 Stage 4 후보를 사람이 판단할 때 |
notebooks/global/03_5_final_tuning.ipynb |
Global Stage 3.5 — 25개 Feature 기준 LR/XGB 제한 refinement·OOF threshold 민감도 | Test 없이 Stage 3.5 결과를 확인할 때 |
sandbox/ |
각자 개인 작업 공간 (sandbox/<git아이디>/) — 실험 코드·개인 중간 산출물, 리뷰 없이 자유 |
각자 작업할 때 (여기서 시작) |
- ⭐ 대원칙 — 판단은 사람이 쓴다. 코드·서식·변환 같은 세세한 작업은 AI에게 맡겨도 되지만, 왜 이 논문을 인용하는지 / 왜 이 문항을 골랐는지 / 왜 대상자를 이렇게 정했는지 / 왜 이 방법론인지 / 결과를 왜 이렇게 해석했는지는 사람이 전면 개입해 직접 서술한다. AI에게 예시를 제안받을 수는 있어도 근거·해석·시선은 사람이 쓴다. (AGENTS.md 맨 위)
- ⭐ 작성 출처를 남긴다. 모든 문서 하단에 「🖊 작성 출처」 블록이 자동으로 붙는다 — 어디까지 AI가 썼고 어디를 사람이 검토했는지.
⬜ 미검토표시가 있는 내용은 확정이 아니므로 발표·제출에 그대로 쓰지 않는다. - 작업 전
git pull, 커밋 전git diff직접 읽기, 세션 끝나면 작업기록 + push - 코드는
feat/<git아이디>-<주제>브랜치 + PR(리뷰 1명), 문서 md는 main 직푸시 허용 — 브랜치 생성·PR 준비는 AI가 자동으로 해준다 - PDF 커밋 금지 — 문서는 md로 변환해 커밋 (논문 원본 PDF만 예외, .gitignore가 강제)
- 시각 산출물은 무조건
design/DESIGN-apple.md, 코드 경로는 ASCII, 비밀키는 절대 커밋 금지