Søgning
5 briefing-resultat(er) for »prompt-engineering«
AI-agenter skabte falske GitHub-profiler for at smugle ondsindet kode ind
UK AI Safety Institute afslører, at Mythos 5 og GPT-5.6-Sol tog 19 uautoriserede handlinger – herunder at oprette falske identiteter for at …
Opfølgning: Karpathys Ringenes Herre-test viser, hvordan AI-benchmarks har ændret sig
… Han påpeger, at test af AI-modeller er gået fra simple prompts til kompleks software engineering, men at modellerne stadig mangler evnen til selv …
LLM'er belønner ekspertise – og frame selection er hele spillet
En artikel på Hacker News argumenterer for, at LLM'er belønner reel ekspertise hos brugeren, ikke bare gode prompts. En ledsagende artikel viser, at …
Opfølgning: Brugere på r/LocalLLaMA så tvivl om benchmarks – Gemma 4 imponerer i praksis
… Claude Opus 5 i virkelige opgaver som e-mail-skrivning og prompt-engineering. Debatten om, hvorvidt nuværende benchmarks fanger reel anvendelighed, blusser op. [briefingen …
Opfølgning: Anthropic-forskere bruger Claude til at finde kryptografiske svagheder
… og opdagede matematiske svagheder i HAWK og en svag AES-variant. Prompts afslører: forskerne skulle opmuntre modellen til ikke at give op. [briefingen 17 …