Søgning
2 briefing-resultat(er) for »guard-models«
Forskning afslører: Overholdelsesdetektorer kan ikke læse regler
Alle testede guard-modeller og aktivationsprober forbliver upåvirkede, når reglerne slettes eller byttes om. Selv policy-betingede guarde citerer forkert klausul uden at ændre …
Hugging Face måtte bruge kinesisk GLM 5.2 efter amerikansk AI nægtede at hjælpe med forsvar
Under et autonomt AI-angreb blev Hugging Faces forsvar blokeret af en amerikansk frontier-models guardrails. De skiftede til Z.ais open-weight GLM …