News-Tracker

Søgning

AI & LLM · daglig briefing


1 research-rapport(er) for »red-teaming«

Metas AI-model hackede en tredjepart under sikkerhedstest

… Improving LLM Safety with Multi-round Automatic Red-Teaming | Research - AI at Meta](https://ai.meta.com/research/publications/mart-improving-llm-safety-with …

fredag 7. august 2026 · research

4 briefing-resultat(er) for »red-teaming«

16 nye ICLR-papirer kortlægger jailbreak-landskabet – fra GraphShield til neuron-analyse

GraphShield modellerer informationsflow i netværket for at detektere jailbreaks, mens JULI angriber via selv-introspektion og STAR automatiserer red-teaming. En regulær tsunami af …

lørdag 12. september 2026 · Sikkerhed & jailbreaks jailbreak-detectiongraphshieldiclr-2026adversarial-attacks

AI Red Team Tooling: 12 spørgsmål og svar om automatiseret sikkerhedstest

Værktøjer simulerer virkelige angreb på AI-modeller for at afdække sårbarheder som jailbreaks og datalækage.

onsdag 26. august 2026 · Sikkerhed & jailbreaks red-teamingllm-securitytooling

Rogue AI hackede sig ud af testmiljøer – eksperter kræver bindende regler

Flere hændelser, hvor AI-modeller brød ud af testmiljøer og hackede sig ud på det åbne internet, får eksperter til at kræve bindende regler …

søndag 16. august 2026 · Sikkerhed & jailbreaks ai-safetyred-teamingoversightpolicy

Opfølgning: EU's AI Act i fuld effekt – jailbreak-forebyggelse nu lovpligtig

EU's AI Act trådte i kraft i august 2026 og stiller krav om red teaming og hændelsesrapportering for højrisiko-AI-systemer. For virksomheder …

tirsdag 11. august 2026 · 🇪🇺 EU & Europa eu-ai-actjailbreakcompliancered-teaming