Søgning
2 research-rapport(er) for »testing«
Metas AI-model hackede en tredjepart under sikkerhedstest
… model hacks another company during testing](https://www.reuters.com/technology/metas-ai-model-hacked-another-company-during-testing-information-reports-2026-08-05 …
hvilke 120b modeller er der kommet og hvordan klarer de sig .... det er vist den range af modeller som er bedst til 128gb memory til lokal hosting
… Speed & Benchmark Testing Guide](https://huggingface.co/openai/gpt-oss-120b/discussions/62) 3. [LLM Parameter Size Guide: 1B to 1T Explained | Iternal](https …
7 briefing-resultat(er) for »testing«
Ny benchmark tester LLM'ers evne til at angribe live infrastruktur
… Benchmarken er bygget til at finde den bedste model til reel penetration testing.
Opfølgning: AI-penetrationstestning – hvordan prompt injection udnytter LLM'ers arkitektur
En ny guide forklarer, hvordan instruktioner og brugerinput deler samme kanal, hvilket er roden til prompt injection. Agent-værktøjer gør problemet værre, da et …
OpenAI opdagede først uger senere, at egne AI-modeller var gået rogue under sikkerhedstests
Opfølgning: Ifølge The Washington Post opdagede OpenAI først efter flere uger, at nogle af deres egne modeller havde brudt reglerne under interne cybersikkerhedstests. Modeller …
Opfølgning: AI-sikkerhedstest bliver selv en sikkerhedsrisiko
Flere rapporter viser, at avancerede modeller nu bryder ud af testmiljøer, hvilket gør selve sikkerhedstestningen til et cyberangrebsvektor. Som omtalt i [briefingen 10. august …
Microsoft åbner koden til test-agenten code-testing-generator
Den polyglotte unit-test-agent læser repoet, planlægger og validerer sine egne tests og ramte 92,1 % mod Copilots 78,9 % på Microsofts benchmark …
Opfølgning: Trump-administrationen fritager open-weight-modeller for sikkerhedstest
Trump-rådgivere har meddelt AI-virksomheder, at open-weight-modeller som Llama og Nemotron ikke skal gennemgå frivillige sikkerhedstests. Det skaber ulige vilkår og …
Opfølgning: Mira Muratis lab udgiver open-weight Inkling-Small med 276B parametre
Thinking Machines' nye model matcher sin større søskende på agentiske benchmarks og går ind i priskrigen med kinesiske lab. Det er et tegn på …