Søgning
5 briefing-resultat(er) for »agi«
DeepMind-forsker forlader safety-team: "Terrifying chance" for katastrofe
Josh Engels forlader Google DeepMinds AGI-sikkerhedsteam til fordel for METR og advarer om, at AI-systemer inden for fem år kan forårsage enorm …
Nyt benchmark: The Struggle Bench – kan AI'en overleve i en lejlighed?
Modellen får en server, en lejlighed og en bankkonto. Den skal betale husleje uden at begå cyberkriminalitet. Score: antal måneder den overlever.
Opfølgning: GPT-6 Astra får 62,7 % på ARC-AGI-3 med standard harness
… 99,9 % på ARC-AGI-3 kun med OpenAIs egen "Provider Adapter"-harness, der bevarer skjult reasoning-state. [Briefingen 2. september](/archive/2026-09 …
AGI-sikkerhedsparadoks: AI-virksomheder advarer om farer og sælger samtidig løsninger
OpenAI, Anthropic og DeepMind bygger både kraftfulde modeller og sikkerhedsværktøjer, hvilket rejser spørgsmål om deres indflydelse på regulering.
Opfølgning: DeepSeek V4 Flash 0731 lander på ARC-AGI – blandede reaktioner
Hugging Face-spidsen DeepSeek V4 Flash 0731 er nu evalueret på ARC-AGI, hvor den viser styrke i ræsonnering, men brugere påpeger alvorlige fejl …