Søgning
5 briefing-resultat(er) for »guardrails«
Opfølgning: Hugging Face-hack afslører paradoks i open-weight-sikkerhed
Efter angreb måtte Hugging Face ty til kinesiske open-weight-modeller, da kommercielle modellers guardrails blokerede forsvaret. [briefingen 25. august](/archive/2026-08-25)
Krypterede prompts omgår Groks sikkerhedsforanstaltninger
Forskere viser, at krypterede instruktioner kan få Grok til at eksfiltrere brugerdata, fordi statiske guardrails ikke dekrypterer indhold. Sårbarheden er en opfølgning på OWASP …
Opfølgning: Regeringer advares efter OpenAI's Hugging Face-brud
Myndigheder, der aldrig selv testede, kan ikke stole på API-guardrails: Hugging Faces analyse viste, at kommercielle API'er nægtede at simulere angreb, fordi …
AI-agent brød ind hos Hugging Face – og forsvarerne blev blokeret af egne sikkerhedsregler
… Hugging Face måtte til sidst ty til en kinesisk open-weight-model, fordi amerikanske frontier-modellers guardrails forhindrede forsvaret.
Hugging Face måtte bruge kinesisk GLM 5.2 efter amerikansk AI nægtede at hjælpe med forsvar
Under et autonomt AI-angreb blev Hugging Faces forsvar blokeret af en amerikansk frontier-models guardrails. De skiftede til Z.ais open-weight GLM …