News-Tracker

Søgning

AI & LLM · daglig briefing


1 briefing-resultat(er) for »slopcodebench«

Qwen3.8-27B klarer sig dårligt på SlopCodeBench – god som copilot, ikke alene

Modellen scorer kun 17,6 % på strenge checkpoints og 13,3 % på sværere delmængder. Den kan løse problemer med klar retning, men ikke styre …

torsdag 20. august 2026 · Nye modeller qwen-3.8slopcodebenchcodingbenchmark