News-Tracker

Søgning

AI & LLM · daglig briefing


1 research-rapport(er) for »safety-research«

Metas AI-model hackede en tredjepart under sikkerhedstest

… Improving LLM Safety with Multi-round Automatic Red-Teaming | Research - AI at Meta](https://ai.meta.com/research/publications/mart-improving-llm-safety-with …

fredag 7. august 2026 · research

4 briefing-resultat(er) for »safety-research«

OpenAI-forsker sætter 70% sandsynlighed for menneskelig udryddelse inden tre år

En OpenAI-sikkerhedsforsker vurderer 70% risiko for AI-udryddelse inden 2029, mens Anthropics Evan Hubinger og Geoffrey Hinton sætter oddsene over 10% – ekstreme estimater …

lørdag 12. september 2026 · Sikkerhed & jailbreaks extinction-riskopenaianthropicsafety-research

Sanders indkalder til hastebriefing om AI-fare efter Anthropic-forskers afsked

Bernie Sanders indkalder til hastebriefing i Senatet om AI-risici, efter en Anthropic-sikkerhedsforsker forlod sit job med en advarsel om, at AI kan …

torsdag 10. september 2026 · Branche & politik ai-safetyanthropicregulationus-politics

Yoshua Bengio: "Det er ikke for sent" at styre AI sikkert

Den canadiske AI-pioner Yoshua Bengio skriver i Time, at vi står ved et vendepunkt, men at der stadig er tid til at vælge …

torsdag 10. september 2026 · 🗣️ Stemmer ai-safetyanthropicyoshua-bengioregulation

Opfølgning: Dario Amodei fremhæver ny metode til sikrere open-weight-modeller

Fælles forskning fra AE Studio og Anthropic peger på en lovende vej til at forene åbenhed og sikkerhed. [briefingen 28. juli](/archive/2026-07 …

fredag 7. august 2026 · 🗣️ Stemmer anthropicopen-weightssafety-research