Søgning
1 research-rapport(er) for »humaneval«
Qwen 3.8 27b
… I en kvantiseringssammenligning opnåede Qwen3.6-27B i Q4_K_M-format 17,5 GB VRAM-forbrug med en HumanEval-pass rate på 74 …
2 briefing-resultat(er) for »humaneval«
Nemotron-3.5-Lightning kører 262K kontekst på 16 GB – med en kvantiserings-fix
… 11,77 GiB, 262K kontekst på et 16 GB-kort og HumanEval på 91,5% – 7 GB mindre end tidligere builds.
GLM 5.3 Flash slår DeepSeek V4 Flash på HumanEval på 2x DGX Spark
En bruger benchmarkede GLM 5.3 Flash (NVFP4) mod DeepSeek V4 Flash 0731 på to DGX Spark: GLM vandt med 97,0% mod 94 …