News-Tracker

Søgning

AI & LLM · daglig briefing


5 briefing-resultat(er) for »agentic-rl«

IBM udgiver Granite 4.2 med indbygget ræsonnement og agentisk RL

… 8B og 30B er trænet med agentisk RL i sandkassemiljøer, og 30B opnår 57% på SWE-Bench.

torsdag 27. august 2026 · Nye modeller ibmgranite-4.2open-weightsagentic-rl

Agentisk AI-sikkerhed: Fra teori til reelle brud

Prompt injection, usikre agent-rammer og autonome angreb er nu konkrete trusler, mens EU's AI Act truer med bøder på 7 % for agent …

tirsdag 25. august 2026 · Sikkerhed & jailbreaks agentic-rlprompt-injectioneu-ai-actautonomous-attack

Apodex 1.1: 35B-agentmodel, der matcher frontløbere

Apodex 1.1 (35B parametre) klarer sig på niveau med langt større systemer på komplekse opgaver – Mini-versionen er lokalt deployerbar.

tirsdag 25. august 2026 · Nye modeller codexagentic-rl35b-modelopen-weights

Lokal AI-DJ: 9B-model driver radiostation på Ollama

En bruger byggede en agentisk DJ, der kører på Qwen3.5 9B med tool-calling og session-hukommelse. Overraskende nok er større modeller ikke …

mandag 27. juli 2026 · Værktøjer & produkter ollamaagentic-rlqwenlocal-ai

SEED: Ny metode til agent-baseret reinforcement learning

Forskere introducerer SEED, der konverterer afsluttede trajektorier til "hindsight skills" og distillerer adfærd tilbage til policy-modellen. Metoden adresserer supervisionsgabet mellem episode-level belønninger …

fredag 17. juli 2026 · Forskning & arkitektur seedreinforcement-learningagentic-rldistillation