Søgning
2 briefing-resultat(er) for »post-training«
AntLing open-sourcer base-modeller for Ling-3.0-tiny og flash
Seks checkpoint uden post-training giver forskere fleksible udgangspunkter. Ling-3.0-tiny (7.9B) matcher større modeller på kode, og flash (124B) klarer …
GLM-5.3 lanceret – post-træning alene giver kæmpe spring i kodning
Z.ai udgav GLM-5.3 uden at ændre basismodellen; alle gevinster kommer fra skaleret post-træning. Modellen fordobler næsten sin score på DeepSWE …