llm-ner-3b / training_meta.json
sigurdriseth's picture
Update new model trained on more multi-product orders.
79a53d0 verified
Raw History Blame Contribute Delete
377 Bytes
{
"base_model": "unsloth/Llama-3.2-3B-Instruct",
"best_epoch": 28,
"best_val_loss": 0.020325099364171952,
"lr": 0.0003,
"effective_batch": 512,
"lora_r": 16,
"lora_alpha": 16,
"lora_target_modules": [
"q_proj",
"k_proj",
"v_proj",
"o_proj",
"gate_proj",
"up_proj",
"down_proj",
"lm_head"
],
"max_seq_len": 512,
"seed": 42
}