Skip to content

Commit 2ea4228

Browse files
committed
chore(justfile): add train and train-cpu recipes
train — full corpus run via run_training.jl (GPU auto-selected) train-cpu — ECHIDNA_MAX_PROOF_STATES=2000 ECHIDNA_NUM_EPOCHS=2 CPU smoke pass Both produce the canonical artefact set (premise_selector.bson, tactic_predictor.bson, vocab.json, model_metadata.txt, metrics_baseline.jsonl). https://claude.ai/code/session_01YPqu7gti4azBach6ZvpRFJ
1 parent de451c9 commit 2ea4228

1 file changed

Lines changed: 12 additions & 0 deletions

File tree

Justfile

Lines changed: 12 additions & 0 deletions
Original file line numberDiff line numberDiff line change
@@ -337,6 +337,18 @@ retrain: align-premises
337337
retrain-skip-align:
338338
julia --project=src/julia src/julia/run_training.jl
339339

340+
# Full training run on the real corpus (auto-selects GPU when available).
341+
# Honours ECHIDNA_MAX_PROOF_STATES, ECHIDNA_NUM_EPOCHS, ECHIDNA_NUM_NEGATIVES.
342+
# Produces models/neural/{premise_selector,tactic_predictor}.bson, vocab.json,
343+
# updates models/model_metadata.txt, and appends to training_data/metrics_baseline.jsonl.
344+
train:
345+
julia --project=src/julia src/julia/run_training.jl
346+
347+
# CPU smoke pass: 2000 proof states, 2 epochs — fast end-to-end sanity check.
348+
# Safe to run on any dev box without a GPU. Produces the same artefacts as `train`.
349+
train-cpu:
350+
ECHIDNA_MAX_PROOF_STATES=2000 ECHIDNA_NUM_EPOCHS=2 julia --project=src/julia src/julia/run_training_cpu.jl
351+
340352
# End-to-end pipeline: provision → extract → merge → align → retrain.
341353
# Use `ECHIDNA_MAX_PROOF_STATES=0 just corpus-refresh` to lift the sample cap.
342354
corpus-refresh: provision-corpora extract-corpora merge-corpora align-premises retrain

0 commit comments

Comments
 (0)