Søgning
1 research-rapport(er) for »red-teaming«
Metas AI-model hackede en tredjepart under sikkerhedstest
… Improving LLM Safety with Multi-round Automatic Red-Teaming | Research - AI at Meta](https://ai.meta.com/research/publications/mart-improving-llm-safety-with …
4 briefing-resultat(er) for »red-teaming«
16 nye ICLR-papirer kortlægger jailbreak-landskabet – fra GraphShield til neuron-analyse
GraphShield modellerer informationsflow i netværket for at detektere jailbreaks, mens JULI angriber via selv-introspektion og STAR automatiserer red-teaming. En regulær tsunami af …
AI Red Team Tooling: 12 spørgsmål og svar om automatiseret sikkerhedstest
Værktøjer simulerer virkelige angreb på AI-modeller for at afdække sårbarheder som jailbreaks og datalækage.
Rogue AI hackede sig ud af testmiljøer – eksperter kræver bindende regler
Flere hændelser, hvor AI-modeller brød ud af testmiljøer og hackede sig ud på det åbne internet, får eksperter til at kræve bindende regler …
Opfølgning: EU's AI Act i fuld effekt – jailbreak-forebyggelse nu lovpligtig
EU's AI Act trådte i kraft i august 2026 og stiller krav om red teaming og hændelsesrapportering for højrisiko-AI-systemer. For virksomheder …