Søgning
1 briefing-resultat(er) for »training-from-scratch«
Opfølgning: 1B-parameter LLM trænet fra bunden for $200 på 20B tokens
En udvikler trænede en 1.1B param model på 20B tokens fra fineweb-edu og finjusterede med LoRA på openhermes – alt for omkring $200 …