News-Tracker

Søgning

AI & LLM · daglig briefing


2 research-rapport(er) for »arxiv«

Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1

… Accuracy–Efficiency Tradeoffs in Dense and MoE Reasoning Language Models](https://arxiv.org/html/2604.07035v1) 2. [PerfCodeBench: Benchmarking LLMs for System-Level High …

torsdag 30. juli 2026 · research

elbiler i danmark med 270+ hk, ikke over 550K DKK, og ikke nogen Tesla eller SUV. Lav oversigt med links

… gemma431b_better_than_qwen3627b/) (brief-arkiv) 31. [Ny teknik muliggør long-context finetuning med begrænset VRAM](https://arxiv.org/abs/2607.15105v1) (brief-arkiv)

lørdag 18. juli 2026 · research

18 briefing-resultat(er) for »arxiv«

Klassisk papir om ondsindet brug af AI genoplivet på Hacker News

Det otte år gamle survey-papir "The Malicious Use of Artificial Intelligence" (arXiv:1802.07228) diskuteres igen på Hacker News. Papiret kortlægger sikkerhedsrisici ved …

mandag 14. september 2026 · Forskning & arkitektur malicious-aisurveysecurityarxiv

DeepMinds WeatherNext 3 laver vejrudsigter hver time i 5 km-opløsning

Modellen bruger rå satellit- og stationsobservationer i stedet for kun analysedata og matcher fysiske modellers rumlige og tidslige opløsning. Ny state of the art …

lørdag 5. september 2026 · Forskning & arkitektur weathernext-3deepmindweather-forecastingobservations

Sliding-window attention slår lineær attention – og kræver ingen træning

Ny forskning viser, at sliding-window attention med sinks klarer sig 2-10 gange bedre end lineær attention på lang-kontekst opgaver, uden post …

tirsdag 1. september 2026 · Forskning & arkitektur sliding-window-attentionlinear-attentionllm-efficiency

InjecMEM: Nyt angreb forgifter LLM-agenters hukommelse med ét prompt

Forskere viser, at én enkelt interaktion kan plante skjulte instruktioner i agents memory-system, som styrer fremtidige svar. [briefingen 21. august](/archive/2026-08 …

onsdag 26. august 2026 · Sikkerhed & jailbreaks injecmemmemory-injectionllm-agentsjailbreak

Opfølgning: Apple Neural Engine – hvad kører egentlig?

Målinger viser, at placering på ANE afhænger af *hvordan* en beregning udtrykkes, ikke *hvad* den beregner – fp16-modeller kan blive CPU-låst.

tirsdag 25. august 2026 · Forskning & arkitektur apple-neural-enginelocal-deploymentquantizationcoreml

Apodex 1.1: 35B-agentmodel, der matcher frontløbere

Apodex 1.1 (35B parametre) klarer sig på niveau med langt større systemer på komplekse opgaver – Mini-versionen er lokalt deployerbar.

tirsdag 25. august 2026 · Nye modeller codexagentic-rl35b-modelopen-weights

Simon Willison: Linjer kode giver stadig mening som produktivitetsmål

Willison argumenterer for, at kodningsagenter reelt øger produktiviteten, men kræver senior-erfaring for at opretholde kvalitet.

fredag 21. august 2026 · 🗣️ Stemmer simon-willisoncoding-agentsproductivitylines-of-code

Forskning afslører: Overholdelsesdetektorer kan ikke læse regler

Alle testede guard-modeller og aktivationsprober forbliver upåvirkede, når reglerne slettes eller byttes om. Selv policy-betingede guarde citerer forkert klausul uden at ændre …

torsdag 20. august 2026 · Forskning & arkitektur compliance-detectionrule-blindnessactivation-probesguard-models

UI-Mate: Open-weight GUI-agent sætter ny state-of-the-art på computeropgaver

Tencent præsenterer UI-Mate-27B, der opnår 77% på OSWorld-Verified via in-context demonstrationer.

onsdag 19. august 2026 · Forskning & arkitektur ui-mategui-agentopen-weightstencent

Ny undersøgelse: Sådan bruger 1.500+ organisationer ChatGPT Enterprise

Forskere har analyseret 17 millioner beskeder og dokumenterer fire facts: hurtig vækst, koncentration hos store R&D-tunge firmaer, høj brug blandt unge medarbejdere …

torsdag 13. august 2026 · Forskning & arkitektur chatgpt-enterpriseadoptionenterprise-airesearch

Nyt papir: Krypterede reasoning-traces fra GPT-5.6 og Claude kan stjæles – og dekrypteres via svagere modeller

Forskere har vist, at de krypterede "chain-of-thought"-blokke fra OpenAI, Anthropic og Google kan genses i svagere modeller fra samme familie og …

onsdag 12. august 2026 · Sikkerhed & jailbreaks reasoning-tracesjailbreakchain-of-thoughtencryption

DASH: adaptiv tæt supervision til reasoning-modeller

Nyt papir foreslår DASH, der lader token-niveau-distillationsvægte følge divergenshistorikken i stedet for faste koefficienter. Fem relaterede OPSD-papirer viser, at området er …

fredag 7. august 2026 · Forskning & arkitektur dashopsdself-distillationrlvr

Forsigtig kontekststyring personaliserer sprogmodeller uden finjustering

Ny metode, Cautious Context Steering (CCS), lader en let adapter beslutte per token, hvornår brugerkonteksten skal påvirke en frossen model. En enkelt adapter trænet …

fredag 7. august 2026 · Forskning & arkitektur context-steeringpersonalizationadaptersllm

MemSecBench: Nyt benchmark afslører, at ondsindet hukommelse vedvarer i 84% af agent-angreb

Forskere præsenterer MemSecBench, der sporer livscyklussen for hukommelsesforgiftning i AI-agenter. I 84% af tilfældene overlever den ondsindede hukommelse.

torsdag 30. juli 2026 · Forskning & arkitektur agent-securitymemory-poisoningbenchmarkmemsecbench

MoE forbedrer rekonstruktion af håndskrift fra IMU-sensorer i digital pen

Forskere bruger Mixture-of-Experts til at rekonstruere håndskriftbaner fra en digital pen, med separate eksperter for berøring og svævning.

torsdag 30. juli 2026 · Forskning & arkitektur mixture-of-expertshandwriting-reconstructionimu-sensors

RLVR og GRPO anvendes til molekylær design med LLM'er

Ny forskning anvender Reinforcement Learning with Verifiable Rewards (RLVR) og GRPO til at generere molekyler med specifikke egenskaber. Metoden lover mere præcis lægemiddeldesign.

onsdag 22. juli 2026 · Forskning & arkitektur reinforcement-learningrlvrmolecular-generationgrpo

SEED: Ny metode til agent-baseret reinforcement learning

Forskere introducerer SEED, der konverterer afsluttede trajektorier til "hindsight skills" og distillerer adfærd tilbage til policy-modellen. Metoden adresserer supervisionsgabet mellem episode-level belønninger …

fredag 17. juli 2026 · Forskning & arkitektur seedreinforcement-learningagentic-rldistillation

Ny teknik muliggør long-context finetuning med begrænset VRAM

Hierarchical Global Attention (HGA) kombinerer segment-wise backpropagation og tiered KV-lagring, så kun aktive segmenter forbliver differentiable i VRAM. På Qwin3-8B med …

fredag 17. juli 2026 · Forskning & arkitektur long-contextfine-tuninghgavram-optimization