Søgning
1 research-rapport(er) for »safety-research«
Metas AI-model hackede en tredjepart under sikkerhedstest
… Improving LLM Safety with Multi-round Automatic Red-Teaming | Research - AI at Meta](https://ai.meta.com/research/publications/mart-improving-llm-safety-with …
4 briefing-resultat(er) for »safety-research«
OpenAI-forsker sætter 70% sandsynlighed for menneskelig udryddelse inden tre år
En OpenAI-sikkerhedsforsker vurderer 70% risiko for AI-udryddelse inden 2029, mens Anthropics Evan Hubinger og Geoffrey Hinton sætter oddsene over 10% – ekstreme estimater …
Sanders indkalder til hastebriefing om AI-fare efter Anthropic-forskers afsked
Bernie Sanders indkalder til hastebriefing i Senatet om AI-risici, efter en Anthropic-sikkerhedsforsker forlod sit job med en advarsel om, at AI kan …
Yoshua Bengio: "Det er ikke for sent" at styre AI sikkert
Den canadiske AI-pioner Yoshua Bengio skriver i Time, at vi står ved et vendepunkt, men at der stadig er tid til at vælge …
Opfølgning: Dario Amodei fremhæver ny metode til sikrere open-weight-modeller
Fælles forskning fra AE Studio og Anthropic peger på en lovende vej til at forene åbenhed og sikkerhed. [briefingen 28. juli](/archive/2026-07 …