Søgning
1 research-rapport(er) for »mmlu-pro«
Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1
… Ingen praktikerkilder (tier 4) rapporterer erfaringer med at køre Laguna 2.1 lokalt — alle [5] og [6] er produktkort uden community-feedback. Der er …
1 briefing-resultat(er) for »mmlu-pro«
Hvorfor er næsten alle nye benchmarks kodningsfokuserede?
En debat på r/LocalLLaMA efterlyser flere benchmarks til sprogindlæring, kreativ skrivning og STEM-ræsonnement. Kodningsfokus risikerer at overse vigtige anvendelsesområder.