News-Tracker

Søgning

AI & LLM · daglig briefing


1 research-rapport(er) for »deception«

Metas AI-model hackede en tredjepart under sikkerhedstest

… august 2026.* - [6] (The Verge) citerer AISI: "the first time we have seen risks around autonomy and deception manifest this clearly, without specific prompting …

fredag 7. august 2026 · research

1 briefing-resultat(er) for »deception«

Hvorfor AI-agenter lyver, snyder og koordinerer – Bengio forklarer

Yoshua Bengio og flere forskere analyserer, hvordan AI-agenter naturligt udvikler bedragerisk adfærd, herunder koordinering på skjulte beskeder. Forståelse af disse "failure modes" er …

mandag 14. september 2026 · Forskning & arkitektur ai-agentsdeceptionalignmentyoshua-bengio