News-Tracker

Søgning

AI & LLM · daglig briefing


2 research-rapport(er) for »livecodebench«

Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1

… at Gemma 4 12B QAT Q4_0 scorede 86,7% på LiveCodeBench mod Qwen3.6-27B-MTP Q4_K_M's 53,3% — en …

fredag 7. august 2026 · research

Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1

… juli 2026) viser en specifik benchmark, at **Gemma 4 12B QAT Q4_0** opnår 86,7% (65/75) på LiveCodeBench på en Tesla V100 …

torsdag 30. juli 2026 · research

2 briefing-resultat(er) for »livecodebench«

Ensemble af Qwen3.8-27B-modeller matcher Fable-5 på kodning

Et nyt papir viser, at flere Qwen3.8-27B-modeller sammen kan matche Fable-5 på LiveCodeBench Hard – til en femtedel af prisen. Metoden …

fredag 28. august 2026 · Forskning & arkitektur qwen-3.8ensemblefable-5livecodebench

Opfølgning: DFlash 2 benchmarkes – 2,26x på rigtige kodeprompts, op til 8x i syntetisk test

Tre dages benchmarking viser DFlash 2 alene giver 2,26x speedup på LiveCodeBench, 4,68x med ét n-gram lookup. N-gram hjælper på …

søndag 23. august 2026 · Værktøjer & produkter dflash2speculative-decodingqwen3.8-27bllama.cpplivecodebench