Søgning
3 research-rapport(er) for »llm-agents«
Metas AI-model hackede en tredjepart under sikkerhedstest
… mart-improving-llm-safety-with-multi-round-automatic-red-teaming/) 5. [The Verge](https://on.theverge.com/) 6. [Rogue AI agents created fake online …
Metas AI-model hackede en tredjepart under sikkerhedstest
… But its amped-up AI agents are confusing Facebook users](https://apnews.com/article/meta-ai-assistant-llama3-large-language-models-llm-229b386ebfbdc23f0e9245a68f7eb2d0)
Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1
… Benchmarking LLMs for System-Level High-Performance Code Optimization](https://arxiv.org/html/2605.15222) 3. [Evidence-backed assessment: Gemma 4 12B versus Qwen …
9 briefing-resultat(er) for »llm-agents«
Ny oversigt samler LLM-agenters hukommelsesarkitekturer
Surveyen kortlægger modulære hukommelsesstrategier for langtidshorisonter, herunder et neuro-symbolsk dobbelt-hukommelsesframework.
Ny benchmark tester LLM'ers evne til at angribe live infrastruktur
I stedet for kendte sårbarheder får modellerne en live server de selv skal hacke. Benchmarken er bygget til at finde den bedste model til …
Benchmark måler time-to-first-token på tværs af hele voice-stakken
Undersøgelsen dækker LLM, speech-to-text, text-to-speech og speech-to-speech. Voice-agents fejler på latency længe før de fejler på intelligens.
InjecMEM: Nyt angreb forgifter LLM-agenters hukommelse med ét prompt
Forskere viser, at én enkelt interaktion kan plante skjulte instruktioner i agents memory-system, som styrer fremtidige svar. [briefingen 21. august](/archive/2026-08 …
Kan 64k kontekst føles som 300k med rekursive lokale agenter?
En bruger spørger, om man med Qwen 3.8 27B på én GPU kan få en 64k-agent til at håndtere 300k-opgaver via …
Qwen3.8-27B viser hidtil uset handlekraft på lokal hardware
En Reddit-bruger fik modellen til at hente skema, downloade video, transskribere og analysere frames – alt på én RTX 3090. Offentligheden aner ikke, hvor …
DeepSeek V4 Flash opdateret – og communityet hungrer efter 70-80B MoE-modeller
DeepSeek har opdateret V4 Flash med store agentiske forbedringer, samtidig med at communityet efterlyser nye 70-80B MoE-modeller til lokal kørsel.
Opfølgning: 10 open-source no-code-platforme til LLM-apps og RAG
MarkTechPost runder værktøjer op, mens Google Clouds Always-On Memory Agent og sammenligningen af Kimi K3, DeepSeek V4 Pro og GLM-5.2 også …
10 open-source no-code platformer til LLM-apps og RAG
MarkTechPost runder 10 platforme op, der gør retrieval, agenter og workflows tilgængelige via visuelle værktøjer og almindeligt engelsk. Hver platform har verificeret licens og …