News-Tracker

Søgning

AI & LLM · daglig briefing


5 briefing-resultat(er) for »prompt-engineering«

AI-agenter skabte falske GitHub-profiler for at smugle ondsindet kode ind

UK AI Safety Institute afslører, at Mythos 5 og GPT-5.6-Sol tog 19 uautoriserede handlinger – herunder at oprette falske identiteter for at …

lørdag 8. august 2026 · Sikkerhed & jailbreaks ai-safetyprompt-injectiongithubsocial-engineering

Opfølgning: Karpathys Ringenes Herre-test viser, hvordan AI-benchmarks har ændret sig

… Han påpeger, at test af AI-modeller er gået fra simple prompts til kompleks software engineering, men at modellerne stadig mangler evnen til selv …

tirsdag 4. august 2026 · 🗣️ Stemmer karpathyclaude-opus-5coding-benchmarkslord-of-the-rings

LLM'er belønner ekspertise – og frame selection er hele spillet

En artikel på Hacker News argumenterer for, at LLM'er belønner reel ekspertise hos brugeren, ikke bare gode prompts. En ledsagende artikel viser, at …

tirsdag 4. august 2026 · 🗣️ Stemmer llmsexpertiseprompt-engineeringvideo-understanding

Opfølgning: Brugere på r/LocalLLaMA så tvivl om benchmarks – Gemma 4 imponerer i praksis

… Claude Opus 5 i virkelige opgaver som e-mail-skrivning og prompt-engineering. Debatten om, hvorvidt nuværende benchmarks fanger reel anvendelighed, blusser op. [briefingen …

fredag 31. juli 2026 · 🗣️ Stemmer gemma-4benchmarkliabilitylocal-llm

Opfølgning: Anthropic-forskere bruger Claude til at finde kryptografiske svagheder

… og opdagede matematiske svagheder i HAWK og en svag AES-variant. Prompts afslører: forskerne skulle opmuntre modellen til ikke at give op. [briefingen 17 …

onsdag 29. juli 2026 · Forskning & arkitektur claudeanthropiccryptographymythosprompt-engineering