Søgning
2 research-rapport(er) for »livecodebench«
Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1
… at Gemma 4 12B QAT Q4_0 scorede 86,7% på LiveCodeBench mod Qwen3.6-27B-MTP Q4_K_M's 53,3% — en …
Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1
… juli 2026) viser en specifik benchmark, at **Gemma 4 12B QAT Q4_0** opnår 86,7% (65/75) på LiveCodeBench på en Tesla V100 …
2 briefing-resultat(er) for »livecodebench«
Ensemble af Qwen3.8-27B-modeller matcher Fable-5 på kodning
Et nyt papir viser, at flere Qwen3.8-27B-modeller sammen kan matche Fable-5 på LiveCodeBench Hard – til en femtedel af prisen. Metoden …
Opfølgning: DFlash 2 benchmarkes – 2,26x på rigtige kodeprompts, op til 8x i syntetisk test
Tre dages benchmarking viser DFlash 2 alene giver 2,26x speedup på LiveCodeBench, 4,68x med ét n-gram lookup. N-gram hjælper på …