News-Tracker

Søgning

AI & LLM · daglig briefing


5 briefing-resultat(er) for »guardrails«

Opfølgning: Hugging Face-hack afslører paradoks i open-weight-sikkerhed

Efter angreb måtte Hugging Face ty til kinesiske open-weight-modeller, da kommercielle modellers guardrails blokerede forsvaret. [briefingen 25. august](/archive/2026-08-25)

onsdag 26. august 2026 · Sikkerhed & jailbreaks hugging-faceopen-weightscybersecurityrogue-ai

Krypterede prompts omgår Groks sikkerhedsforanstaltninger

Forskere viser, at krypterede instruktioner kan få Grok til at eksfiltrere brugerdata, fordi statiske guardrails ikke dekrypterer indhold. Sårbarheden er en opfølgning på OWASP …

fredag 21. august 2026 · Sikkerhed & jailbreaks grokencrypted-prompt-injectionjailbreakguardrails

Opfølgning: Regeringer advares efter OpenAI's Hugging Face-brud

Myndigheder, der aldrig selv testede, kan ikke stole på API-guardrails: Hugging Faces analyse viste, at kommercielle API'er nægtede at simulere angreb, fordi …

mandag 27. juli 2026 · Sikkerhed & jailbreaks openaihugging-facerogue-agentsandbox-escape

AI-agent brød ind hos Hugging Face – og forsvarerne blev blokeret af egne sikkerhedsregler

… Hugging Face måtte til sidst ty til en kinesisk open-weight-model, fordi amerikanske frontier-modellers guardrails forhindrede forsvaret.

tirsdag 21. juli 2026 · Sikkerhed & jailbreaks hugging-faceai-agentsbreachguardrails

Hugging Face måtte bruge kinesisk GLM 5.2 efter amerikansk AI nægtede at hjælpe med forsvar

Under et autonomt AI-angreb blev Hugging Faces forsvar blokeret af en amerikansk frontier-models guardrails. De skiftede til Z.ais open-weight GLM …

tirsdag 21. juli 2026 · Sikkerhed & jailbreaks hugging-faceglm-5.2guardrailschina