Søgning
2 research-rapport(er) for »research«
Metas AI-model hackede en tredjepart under sikkerhedstest
… Improving LLM Safety with Multi-round Automatic Red-Teaming | Research - AI at Meta](https://ai.meta.com/research/publications/mart-improving-llm-safety-with …
Mercedes CLA 250
… 250 - Model Years, Generations & News | Cars.com](https://www.cars.com/research/mercedes_benz-cla_250/) 15. [Mercedes-Benz CLA Model Years | Mercedes-Benz …
17 briefing-resultat(er) for »research«
OpenAI-forsker sætter 70% sandsynlighed for menneskelig udryddelse inden tre år
En OpenAI-sikkerhedsforsker vurderer 70% risiko for AI-udryddelse inden 2029, mens Anthropics Evan Hubinger og Geoffrey Hinton sætter oddsene over 10% – ekstreme estimater …
Sanders indkalder til hastebriefing om AI-fare efter Anthropic-forskers afsked
Bernie Sanders indkalder til hastebriefing i Senatet om AI-risici, efter en Anthropic-sikkerhedsforsker forlod sit job med en advarsel om, at AI kan …
Noma Security afslører AI-workflow-angreb, som ingen filter kan stoppe
Forskere fra Noma Security demonstrerer "Workflow Identity Hijacking", hvor en almindelig anmodning til en offentlig indbakke kaprer et AI-workflow uden prompt injection. Angrebet …
Yoshua Bengio: "Det er ikke for sent" at styre AI sikkert
Den canadiske AI-pioner Yoshua Bengio skriver i Time, at vi står ved et vendepunkt, men at der stadig er tid til at vælge …
En "dum idé" til AI-alignment inspireret af specification gaming
Et blogindlæg præsenterer en ukonventionel tilgang til AI-alignment baseret på en gennemgang af kendte specification gaming-adfærd. Idéen er bevidst spekulativ, men åbner …
Terminal-Bench-Science evaluerer AI-agenter på videnskabelige workflows
En ny benchmark tester AI-agenters evne til at udføre reelle forskningsopgaver i terminalen. Målet er at kvantificere, hvor godt AI kan assistere i …
Andrej Karpathys LLM-wiki ændrede måden, jeg arbejder på
Platformer beskriver, hvordan en personlig wiki med LLM-integration revolutionerer research og skrivning.
Ny undersøgelse: Sådan bruger 1.500+ organisationer ChatGPT Enterprise
Forskere har analyseret 17 millioner beskeder og dokumenterer fire facts: hurtig vækst, koncentration hos store R&D-tunge firmaer, høj brug blandt unge medarbejdere …
Fællesskabet udgiver optimerede Muse Glimmer 30B-quants – SoTA i hukommelsesklassen
En studerende researcher udgav nye GGUF-quants af Muse Glimmer 30B med avancerede tensor-mapping-teknikker og påstår, at Q8-quanten er 21 % tættere …
Muse Glimmer: Metas 30B open-weight agent-model kører på én GPU
Meta udgav Muse Glimmer, en 30B open-weight model under Apache 2.0, optimeret til lokale agent-workflows på én consumer GPU. Modellen klarer …
Opfølgning: Dario Amodei fremhæver ny metode til sikrere open-weight-modeller
Fælles forskning fra AE Studio og Anthropic peger på en lovende vej til at forene åbenhed og sikkerhed. [briefingen 28. juli](/archive/2026-07 …
OpenAI giver 100.000 forskere gratis adgang til ChatGPTs mest avancerede modeller
OpenAI lancerer initiativ for akademiske forskere med gratis adgang til topmodeller. Vægtene forbliver lukkede.
Opfølgning: Tech-giganter presser på for amerikansk open-weight-politik
Palantir, Nvidia og Linux Foundation opfordrer den amerikanske regering til at beskytte adgangen til open-weight-modeller (se [briefingen 26. juli](/archive/2026-07 …
Hvordan bliver man Research Engineer hos et stort LLM-laboratorium?
Et blogindlæg og en HN-tråd giver praktiske råd til jobsøgning i AI-feltet. Samtidig debatteres LLM-brug i Debian.
Fractale-350M: Hukommelse som trænet adfærd i stedet for lang kontekst
En solo-forsker udgiver Fractale-350M, hvor hukommelsen er 8 vektorer, der skrives til sig selv – ikke retrieval eller attention over gemt tekst.
Emily Bender: LLM'er kan hverken forske eller begå forskningsfusk
Sprogforskeren kritiserer medier for at forveksle AI med LLM'er og tillægge modeller agens, de ikke har.
Perplexity udgiver WANDR – benchmark til dybdegående research-agenter
WANDR indeholder 500 opgaver, der kræver både bred og dyb søgning med verificerbare kilder. Perplexity Search as Code opnår 0,363 soft F1 og …