v1 - Project Skeleton¶
Progress¶
⬜ STEP 1: Load Data
⬜ STEP 2: Split Train/Test
⬜ STEP 3: Create Pipeline
⬜ STEP 4: Train Pipeline
⬜ STEP 5: Evaluate & Metrics
⬜ STEP 6: Save Pipeline
⬜ STEP 7: Save Metrics JSON
What's In This Version¶
Starting point - all files are empty stubs (docstrings only, no code).
Students see the full project structure before writing any code:
v1_base_ccfd-project/
├── p1_01_generate_initial_dataset.py # Data generation (ready to use)
├── p3_01_train_model_baseline.py # Training script (stub)
├── requirements.txt
└── utils/
├── __init__.py # Package init (stub)
├── data_utils.py # Data utilities (stub)
├── model_utils.py # Model utilities (stub)
└── metrics_utils.py # Metrics utilities (stub)
What's New¶
- Project folder structure created
- All utility modules defined as stubs
p1_01_generate_initial_dataset.pyis fully functional (generates synthetic data)p3_01_train_model_baseline.pyis a stub (no steps yet)
How to Run¶
cd v1_base_ccfd-project/
# Only data generation works at this stage
python p1_01_generate_initial_dataset.py
Note:
p3_01_train_model_baseline.pyhas no code yet - it's just a docstring.
Next Version¶
v2 → Implement load_data() and add STEP 1 to the training script.
Prefer to learn by watching?
The video course builds this whole project with you on screen, step by step.