Commit History

Training status: step 352000
1ff8b12
verified

tekkmaven commited on

Checkpoint weights: step 352000 (1667MB)
4419a6f
verified

tekkmaven commited on

Training status: step 336000
b3c73e2
verified

tekkmaven commited on

Checkpoint weights: step 336000 (1667MB)
771e2ad
verified

tekkmaven commited on

Training status: step 320000
a9bc40d
verified

tekkmaven commited on

Checkpoint weights: step 320000 (1666MB)
181f5c4
verified

tekkmaven commited on

Training status: step 304000
04041d9
verified

tekkmaven commited on

Checkpoint weights: step 304000 (1667MB)
3b5c2f0
verified

tekkmaven commited on

Training status: step 288000
f4126b2
verified

tekkmaven commited on

Checkpoint weights: step 288000 (1667MB)
9395900
verified

tekkmaven commited on

Training status: step 272000
3622f7e
verified

tekkmaven commited on

Checkpoint weights: step 272000 (1666MB)
db1a37a
verified

tekkmaven commited on

Training status: step 256000
4e8123c
verified

tekkmaven commited on

Checkpoint weights: step 256000 (1667MB)
4402a06
verified

tekkmaven commited on

Training status: step 240000
2704215
verified

tekkmaven commited on

Checkpoint weights: step 240000 (1667MB)
d69c665
verified

tekkmaven commited on

Training status: step 224000
c9c1faf
verified

tekkmaven commited on

Checkpoint weights: step 224000 (1667MB)
e2fa33d
verified

tekkmaven commited on

Training status: step 208000
01efe26
verified

tekkmaven commited on

Checkpoint weights: step 208000 (1666MB)
e2bef11
verified

tekkmaven commited on

Training status: step 192000
b087da5
verified

tekkmaven commited on

Checkpoint weights: step 192000 (1665MB)
190759f
verified

tekkmaven commited on

Training status: step 176000
ad408e0
verified

tekkmaven commited on

Checkpoint weights: step 176000 (1666MB)
270c549
verified

tekkmaven commited on

Training status: step 160000
7fc6928
verified

tekkmaven commited on

Checkpoint weights: step 160000 (1666MB)
3054872
verified

tekkmaven commited on

Training status: step 144000
dabb0f9
verified

tekkmaven commited on

Checkpoint weights: step 144000 (1666MB)
3f7e2e0
verified

tekkmaven commited on

Training status: step 128000
07469ea
verified

tekkmaven commited on

Checkpoint weights: step 128000 (1666MB)
8d3a460
verified

tekkmaven commited on

Training status: step 112000
107d7e2
verified

tekkmaven commited on

Checkpoint weights: step 112000 (1664MB)
42f2552
verified

tekkmaven commited on

Training status: step 96000
aebd4fb
verified

tekkmaven commited on

Checkpoint weights: step 96000 (1666MB)
7871a7c
verified

tekkmaven commited on

Training status: step 80000
0e4bcd7
verified

tekkmaven commited on

Checkpoint weights: step 80000 (1666MB)
6863f70
verified

tekkmaven commited on

Training status: step 64000
114bae5
verified

tekkmaven commited on

Checkpoint weights: step 64000 (1666MB)
79ca53f
verified

tekkmaven commited on

Training status: step 48000
4bf1029
verified

tekkmaven commited on

Checkpoint weights: step 48000 (1666MB)
9063b83
verified

tekkmaven commited on

Remove stale training_status.json from diverged run
df69066
verified

tekkmaven commited on

Always pass --resume so train.py checks Hub when local is empty"
abb62fc
verified

tekkmaven commited on

Auto-resume from Hub when local checkpoints are cleared by Kaggle\n\nNow --resume checks: local disk first β†’ Hub download fallback β†’ fresh start\nNo more lost progress across Kaggle sessions."
b2c7b9b
verified

tekkmaven commited on

Training status: step 32000
523eb1c
verified

tekkmaven commited on

Checkpoint weights: step 32000 (1668MB)
dcd216f
verified

tekkmaven commited on

Training status: step 16000
b7e64d7
verified

tekkmaven commited on

Checkpoint weights: step 16000 (1671MB)
7c08bcf
verified

tekkmaven commited on

Fix divergence: peak_lr 1e-3 β†’ 3e-4, max_grad_norm 1.0 β†’ 0.5 (batch=8 too small for high LR)"
9492039
verified

tekkmaven commited on

Delete stale checkpoint from diverged run
554b735
verified

tekkmaven commited on

Training status: step 16000
7d6db81
verified

tekkmaven commited on