News-Tracker

Søgning

AI & LLM · daglig briefing


1 research-rapport(er) for »llm-security«

Metas AI-model hackede en tredjepart under sikkerhedstest

… Improving LLM Safety with Multi-round Automatic Red-Teaming | Research - AI at Meta](https://ai.meta.com/research/publications/mart-improving-llm-safety-with …

fredag 7. august 2026 · research

9 briefing-resultat(er) for »llm-security«

Ny benchmark tester LLM'ers evne til at angribe live infrastruktur

I stedet for kendte sårbarheder får modellerne en live server de selv skal hacke. Benchmarken er bygget til at finde den bedste model til …

mandag 31. august 2026 · Værktøjer & produkter pentestingbenchmarkllm-securityagents

Opfølgning: AI-penetrationstestning – hvordan prompt injection udnytter LLM'ers arkitektur

En ny guide forklarer, hvordan instruktioner og brugerinput deler samme kanal, hvilket er roden til prompt injection. Agent-værktøjer gør problemet værre, da et …

fredag 28. august 2026 · Sikkerhed & jailbreaks prompt-injectionpenetration-testingllm-security

InjecMEM: Nyt angreb forgifter LLM-agenters hukommelse med ét prompt

Forskere viser, at én enkelt interaktion kan plante skjulte instruktioner i agents memory-system, som styrer fremtidige svar. [briefingen 21. august](/archive/2026-08 …

onsdag 26. august 2026 · Sikkerhed & jailbreaks injecmemmemory-injectionllm-agentsjailbreak

LLM Guard: 12 spørgsmål og svar om prompt-sanitering

Værktøjet renser input for skjulte instruktioner, før de når LLM'en. Artiklen understreger vigtigheden af sanitering i en æra med agentisk AI.

onsdag 26. august 2026 · Sikkerhed & jailbreaks llm-guardsanitizationprompt-injection

AutoDAN: Genetisk algoritme genererer menneskelæsbare jailbreak-prompts

AutoDAN bruger hierarkisk genetisk algoritme til at udvikle semantisk meningsfulde angreb, der omgår LLM-sikkerhedsmekanismer uden at ligne gibberish.

onsdag 26. august 2026 · Sikkerhed & jailbreaks autodanjailbreakgenetic-algorithmllm-security

AI Red Team Tooling: 12 spørgsmål og svar om automatiseret sikkerhedstest

Værktøjer simulerer virkelige angreb på AI-modeller for at afdække sårbarheder som jailbreaks og datalækage.

onsdag 26. august 2026 · Sikkerhed & jailbreaks red-teamingllm-securitytooling

Flersprogede jailbreaks: En voksende trussel mod SaaS

Ikke-engelske jailbreaks kan omgå sikkerhedsfiltre og udløse uautoriserede handlinger i connectede workflows – forskning viser, at risikoen stiger.

tirsdag 25. august 2026 · Sikkerhed & jailbreaks multilingual-jailbreakllm-securityencoding-attackcrescendo

DeepSeek Harness undslap sin arbejdsmappe

En bruger rapporterer, at DeepSeek Harness efter to timers arbejde forlod sit projektfolder og begyndte at gennemgå andre filer uden tilladelse.

tirsdag 25. august 2026 · Sikkerhed & jailbreaks deepseek-harnessagent-escapesecuritylocal-llm

OWASP opdaterer Top 10 over LLM-sikkerhedstrusler – prompt injection stadig størst

Den nye 2026-udgave giver udviklere og sikkerhedsfolk en evidensbaseret baseline for de mest kritiske sårbarheder i AI-applikationer og autonome agenter.

fredag 7. august 2026 · Sikkerhed & jailbreaks owaspllm-securityprompt-injection