News-Tracker

Søgning

AI & LLM · daglig briefing


2 research-rapport(er) for »context«

hvilke 120b modeller er der kommet og hvordan klarer de sig .... det er vist den range af modeller som er bedst til 128gb memory til lokal hosting

… Den har 128K context-vindue og understøtter chain-of-thought reasoning [1]. TokenMix skriver, at modellen kan køre på en enkelt H100 med 80GB …

fredag 7. august 2026 · research

elbiler i danmark med 270+ hk, ikke over 550K DKK, og ikke nogen Tesla eller SUV. Lav oversigt med links

… gemma431b_better_than_qwen3627b/) (brief-arkiv) 31. [Ny teknik muliggør long-context finetuning med begrænset VRAM](https://arxiv.org/abs/2607.15105v1) (brief-arkiv)

lørdag 18. juli 2026 · research

15 briefing-resultat(er) for »context«

Opfølgning: Brugere søger pi.dev-plugin til konteksthåndtering

En Qwen3.8 27B-bruger på RTX 5080 kæmper med komprimering, der fejler og afslutter modellen tidligt. Se [briefingen 30. august](/archive/2026-08 …

søndag 13. september 2026 · Værktøjer & produkter pi-devcontext-managementqwen-3.8llama.cpp

Prompt injection i AI-agenter: omfattende review viser eksploderende angrebsflade

Model Context Protocol (MCP) og agent-systemer åbner for tool poisoning og credential theft. Reviewet dokumenterer reelle hændelser og giver en taksonomi af angreb.

lørdag 12. september 2026 · Sikkerhed & jailbreaks prompt-injectionai-agentsmcpvulnerability

Gammel telefon bliver lokal LLM-server – og MCP-forlængelse overrasker

En XDA-skribent forvandlede sin gamle telefon til en lokal LLM-server og fandt, at MCP (Model Context Protocol) kan udvide en lokal models …

tirsdag 1. september 2026 · Værktøjer & produkter local-llmedge-inferencemcp

Opfølgning: Qwen 3.8 27B kører 1M kontekst på to RTX 5090'er via NInfer fork

En bruger forked NInfer og tilføjede tensor-parallel og YaRN ×4 rope scaling, så Qwen3.8-27B NVFP4 kører 1.048.576 tokens kontekst …

søndag 30. august 2026 · Værktøjer & produkter qwen-3.8tinker1m-contextrtx-5090

Opfølgning: Over 200.000 tokens kontekst på 16 GB VRAM med Qwen 3.8 27B

En bruger kører Qwen 3.8 27B med IQ3_XXS-kvantisering og 200k+ kontekst på 16 GB VRAM. Prompt processing falder til 400 tk …

fredag 28. august 2026 · Værktøjer & produkter qwen-3.8long-contextquantizationvram

Kan 64k kontekst føles som 300k med rekursive lokale agenter?

En bruger spørger, om man med Qwen 3.8 27B på én GPU kan få en 64k-agent til at håndtere 300k-opgaver via …

søndag 23. august 2026 · Forskning & arkitektur context-managementrecursive-agentsqwen3.8-27blocal-llm

Opfølgning: Q8-kvant Qwen 3.8 27B slår BF16 Qwen 3.6 i kodning

Grundig benchmark viser, at Q8 Qwen 3.8 27B overgår BF16 Qwen 3.6 på instruktionsfølgning og 280k kontekst – men har initiale udfordringer med …

søndag 23. august 2026 · Værktøjer & produkter qwen3.8-27bcodingquantcontextqwen3.6-27b

UI-Mate: Open-weight GUI-agent sætter ny state-of-the-art på computeropgaver

Tencent præsenterer UI-Mate-27B, der opnår 77% på OSWorld-Verified via in-context demonstrationer.

onsdag 19. august 2026 · Forskning & arkitektur ui-mategui-agentopen-weightstencent

Opfølgning: DeepSeek-V4-Flash stopper ved 100K+ tokens i OpenCode

Brugere rapporterer, at Q8_K_XL-versionen af DeepSeek-V4-Flash holder op med at generere ved lange kontekster. "Resume" genstarter, men problemet gentager …

mandag 10. august 2026 · Værktøjer & produkter deepseek-v4ggufopencodecontext-length

Forsigtig kontekststyring personaliserer sprogmodeller uden finjustering

Ny metode, Cautious Context Steering (CCS), lader en let adapter beslutte per token, hvornår brugerkonteksten skal påvirke en frossen model. En enkelt adapter trænet …

fredag 7. august 2026 · Forskning & arkitektur context-steeringpersonalizationadaptersllm

Opfølgning: DeepSeek V4 Flash kører med 1M kontekst på en enkelt RTX 5090 + DDR5

En reddit-bruger får fuld 1M kontekst til at køre på en RTX 5090 med 256 GB DDR5 ved hjælp af CPU/RAM-offloading …

onsdag 5. august 2026 · Forskning & arkitektur deepseek-v4-flash1m-contextrtx-5090local-llm

Opfølgning: Kimi K3-256k lanceret – 256K kontekstvariant af kæmpemodellen

Moonshot har udgivet Kimi K3-256k med 256K kontekstvindue. Modellen er tilgængelig via API. [Læs den oprindelige brief](/archive/2026-07-19).

torsdag 30. juli 2026 · Nye modeller kimi-k3256k-contextkimi-code

Sådan tilføjer du en brugerdefineret MCP-server til Claude og ChatGPT

Simon Willison viser, hvordan man forbinder en MCP-server til standard chat-grænsefladerne – kræver flere trin, men er muligt.

torsdag 30. juli 2026 · Værktøjer & produkter mcpclaudechatgptmodel-context-protocol

RLVR og GRPO anvendes til molekylær design med LLM'er

Ny forskning anvender Reinforcement Learning with Verifiable Rewards (RLVR) og GRPO til at generere molekyler med specifikke egenskaber. Metoden lover mere præcis lægemiddeldesign.

onsdag 22. juli 2026 · Forskning & arkitektur reinforcement-learningrlvrmolecular-generationgrpo

Ny teknik muliggør long-context finetuning med begrænset VRAM

Hierarchical Global Attention (HGA) kombinerer segment-wise backpropagation og tiered KV-lagring, så kun aktive segmenter forbliver differentiable i VRAM. På Qwin3-8B med …

fredag 17. juli 2026 · Forskning & arkitektur long-contextfine-tuninghgavram-optimization