News-Tracker

Søgning

AI & LLM · daglig briefing


2 briefing-resultat(er) for »guard-models«

Forskning afslører: Overholdelsesdetektorer kan ikke læse regler

Alle testede guard-modeller og aktivationsprober forbliver upåvirkede, når reglerne slettes eller byttes om. Selv policy-betingede guarde citerer forkert klausul uden at ændre …

torsdag 20. august 2026 · Forskning & arkitektur compliance-detectionrule-blindnessactivation-probesguard-models

Hugging Face måtte bruge kinesisk GLM 5.2 efter amerikansk AI nægtede at hjælpe med forsvar

Under et autonomt AI-angreb blev Hugging Faces forsvar blokeret af en amerikansk frontier-models guardrails. De skiftede til Z.ais open-weight GLM …

tirsdag 21. juli 2026 · Sikkerhed & jailbreaks hugging-faceglm-5.2guardrailschina