1.3GB짜리 폴더를 그대로 GitHub Pages에 올려서 브라우징시키는 건 방문자한테 의미가 없다(대부분 .safetensors 모델 가중치·jsonl 학습셋). 대신 실제로 뭐가 쌓여있는지 파일 타입·개수·용량으로 정직하게 밝힌다.
| 총 용량 | 1.3GB |
| 총 파일 수 | 79개 |
| .json | 22개 |
| .jsonl (학습셋) | 17개 |
| .md | 12개 |
| .txt | 6개 |
| .safetensors (모델 가중치) | 6개 |
| .py / .sh (파이프라인 코드) | 8개 |
가장 큰 학습셋 (jsonl 줄 수)
| parksy_real_extracted.jsonl | 39,843줄 |
| parksy_april13_extracted.jsonl | 20,724줄 |
| parksy_real_v2_extracted.jsonl | 9,910줄 |
| merged_training_data.jsonl | 4,218줄 |
| chatgpt_parsed.jsonl | 2,756줄 |
원본 확인: du -sh finetune ·
find finetune -type f | sed 's/.*\./ /' | sort | uniq -c (2026-07-16 실측)