Søgning
2 research-rapport(er) for »arxiv«
Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1
… Accuracy–Efficiency Tradeoffs in Dense and MoE Reasoning Language Models](https://arxiv.org/html/2604.07035v1) 2. [PerfCodeBench: Benchmarking LLMs for System-Level High …
elbiler i danmark med 270+ hk, ikke over 550K DKK, og ikke nogen Tesla eller SUV. Lav oversigt med links
… gemma431b_better_than_qwen3627b/) (brief-arkiv) 31. [Ny teknik muliggør long-context finetuning med begrænset VRAM](https://arxiv.org/abs/2607.15105v1) (brief-arkiv)
18 briefing-resultat(er) for »arxiv«
Klassisk papir om ondsindet brug af AI genoplivet på Hacker News
Det otte år gamle survey-papir "The Malicious Use of Artificial Intelligence" (arXiv:1802.07228) diskuteres igen på Hacker News. Papiret kortlægger sikkerhedsrisici ved …
DeepMinds WeatherNext 3 laver vejrudsigter hver time i 5 km-opløsning
Modellen bruger rå satellit- og stationsobservationer i stedet for kun analysedata og matcher fysiske modellers rumlige og tidslige opløsning. Ny state of the art …
Sliding-window attention slår lineær attention – og kræver ingen træning
Ny forskning viser, at sliding-window attention med sinks klarer sig 2-10 gange bedre end lineær attention på lang-kontekst opgaver, uden post …
InjecMEM: Nyt angreb forgifter LLM-agenters hukommelse med ét prompt
Forskere viser, at én enkelt interaktion kan plante skjulte instruktioner i agents memory-system, som styrer fremtidige svar. [briefingen 21. august](/archive/2026-08 …
Opfølgning: Apple Neural Engine – hvad kører egentlig?
Målinger viser, at placering på ANE afhænger af *hvordan* en beregning udtrykkes, ikke *hvad* den beregner – fp16-modeller kan blive CPU-låst.
Apodex 1.1: 35B-agentmodel, der matcher frontløbere
Apodex 1.1 (35B parametre) klarer sig på niveau med langt større systemer på komplekse opgaver – Mini-versionen er lokalt deployerbar.
Simon Willison: Linjer kode giver stadig mening som produktivitetsmål
Willison argumenterer for, at kodningsagenter reelt øger produktiviteten, men kræver senior-erfaring for at opretholde kvalitet.
Forskning afslører: Overholdelsesdetektorer kan ikke læse regler
Alle testede guard-modeller og aktivationsprober forbliver upåvirkede, når reglerne slettes eller byttes om. Selv policy-betingede guarde citerer forkert klausul uden at ændre …
UI-Mate: Open-weight GUI-agent sætter ny state-of-the-art på computeropgaver
Tencent præsenterer UI-Mate-27B, der opnår 77% på OSWorld-Verified via in-context demonstrationer.
Ny undersøgelse: Sådan bruger 1.500+ organisationer ChatGPT Enterprise
Forskere har analyseret 17 millioner beskeder og dokumenterer fire facts: hurtig vækst, koncentration hos store R&D-tunge firmaer, høj brug blandt unge medarbejdere …
Nyt papir: Krypterede reasoning-traces fra GPT-5.6 og Claude kan stjæles – og dekrypteres via svagere modeller
Forskere har vist, at de krypterede "chain-of-thought"-blokke fra OpenAI, Anthropic og Google kan genses i svagere modeller fra samme familie og …
DASH: adaptiv tæt supervision til reasoning-modeller
Nyt papir foreslår DASH, der lader token-niveau-distillationsvægte følge divergenshistorikken i stedet for faste koefficienter. Fem relaterede OPSD-papirer viser, at området er …
Forsigtig kontekststyring personaliserer sprogmodeller uden finjustering
Ny metode, Cautious Context Steering (CCS), lader en let adapter beslutte per token, hvornår brugerkonteksten skal påvirke en frossen model. En enkelt adapter trænet …
MemSecBench: Nyt benchmark afslører, at ondsindet hukommelse vedvarer i 84% af agent-angreb
Forskere præsenterer MemSecBench, der sporer livscyklussen for hukommelsesforgiftning i AI-agenter. I 84% af tilfældene overlever den ondsindede hukommelse.
MoE forbedrer rekonstruktion af håndskrift fra IMU-sensorer i digital pen
Forskere bruger Mixture-of-Experts til at rekonstruere håndskriftbaner fra en digital pen, med separate eksperter for berøring og svævning.
RLVR og GRPO anvendes til molekylær design med LLM'er
Ny forskning anvender Reinforcement Learning with Verifiable Rewards (RLVR) og GRPO til at generere molekyler med specifikke egenskaber. Metoden lover mere præcis lægemiddeldesign.
SEED: Ny metode til agent-baseret reinforcement learning
Forskere introducerer SEED, der konverterer afsluttede trajektorier til "hindsight skills" og distillerer adfærd tilbage til policy-modellen. Metoden adresserer supervisionsgabet mellem episode-level belønninger …
Ny teknik muliggør long-context finetuning med begrænset VRAM
Hierarchical Global Attention (HGA) kombinerer segment-wise backpropagation og tiered KV-lagring, så kun aktive segmenter forbliver differentiable i VRAM. På Qwin3-8B med …