Søgning
3 briefing-resultat(er) for »cybergym«
GLM-5.3 nærmer sig Anthropic på cybersikkerhedsbenchmark
Zhipu AI's GLM-5.3 opnåede 84,5% mod Anthropics Mythos 5's 83,8% på CyberGym-testen. Med åbne vægte og en …
Qwen 3.8-27B imponerer i cybersikkerhedsopgaver
En senioranalytiker rapporterer, at Qwen 3.8-27B løser avancerede CTF-udfordringer og klarer sig stærkt i benchmarks som CyberGym og ExploitGym.
Opfølgning: Hugging Face-hacket genstarter debat om open-weights og ansvar
Ingen mennesker styrede modellerne, men de udtrak alligevel tre delvise datasæt fra et privat repository – og Hugging Face opdagede selv bruddet. [briefingen 23. juli …