News-Tracker

Søgning

AI & LLM · daglig briefing


5 briefing-resultat(er) for »agi«

DeepMind-forsker forlader safety-team: "Terrifying chance" for katastrofe

Josh Engels forlader Google DeepMinds AGI-sikkerhedsteam til fordel for METR og advarer om, at AI-systemer inden for fem år kan forårsage enorm …

mandag 14. september 2026 · 🗣️ Stemmer deepmindmetrjosh-engelssafe-superintelligence

Nyt benchmark: The Struggle Bench – kan AI'en overleve i en lejlighed?

Modellen får en server, en lejlighed og en bankkonto. Den skal betale husleje uden at begå cyberkriminalitet. Score: antal måneder den overlever.

mandag 7. september 2026 · Forskning & arkitektur benchmarkstruggle-benchagisurvival

Opfølgning: GPT-6 Astra får 62,7 % på ARC-AGI-3 med standard harness

… 99,9 % på ARC-AGI-3 kun med OpenAIs egen "Provider Adapter"-harness, der bevarer skjult reasoning-state. [Briefingen 2. september](/archive/2026-09 …

fredag 4. september 2026 · Forskning & arkitektur arc-agi-3gpt-6-astrareasoningbenchmark

AGI-sikkerhedsparadoks: AI-virksomheder advarer om farer og sælger samtidig løsninger

OpenAI, Anthropic og DeepMind bygger både kraftfulde modeller og sikkerhedsværktøjer, hvilket rejser spørgsmål om deres indflydelse på regulering.

lørdag 15. august 2026 · Branche & politik ai-safetygovernancefrontier-labs

Opfølgning: DeepSeek V4 Flash 0731 lander på ARC-AGI – blandede reaktioner

Hugging Face-spidsen DeepSeek V4 Flash 0731 er nu evalueret på ARC-AGI, hvor den viser styrke i ræsonnering, men brugere påpeger alvorlige fejl …

lørdag 8. august 2026 · Nye modeller deepseek-v4-flasharc-agibenchmark