News-Tracker

Søgning

AI & LLM · daglig briefing


1 research-rapport(er) for »real-swe«

Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1

… til "real coding agent work" på en enkelt 24GB GPU (RTX 3090Ti). Kilden angiver, at Qwen3.6-27B opnår **77,2% på SWE-bench …

torsdag 30. juli 2026 · research

1 briefing-resultat(er) for »real-swe«

Real-SWE: Nyt benchmark tester AI på private virksomhedskodebaser

Benchmarket evaluerer modeller på rigtige, private enterprise-kodebaser frem for syntetiske opgaver. Diskuteres på Hacker News og r/LocalLLaMA.

søndag 13. september 2026 · Forskning & arkitektur real-swebenchmarkenterprise-codecoding-agents