News-Tracker

Søgning

AI & LLM · daglig briefing


1 research-rapport(er) for »mmlu-pro«

Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1

… Ingen praktikerkilder (tier 4) rapporterer erfaringer med at køre Laguna 2.1 lokalt — alle [5] og [6] er produktkort uden community-feedback. Der er …

fredag 7. august 2026 · research

1 briefing-resultat(er) for »mmlu-pro«

Hvorfor er næsten alle nye benchmarks kodningsfokuserede?

En debat på r/LocalLLaMA efterlyser flere benchmarks til sprogindlæring, kreativ skrivning og STEM-ræsonnement. Kodningsfokus risikerer at overse vigtige anvendelsesområder.

søndag 2. august 2026 · Forskning & arkitektur benchmarkcoding-biasmmlu-proevaluation