Søgning
2 research-rapport(er) for »context«
hvilke 120b modeller er der kommet og hvordan klarer de sig .... det er vist den range af modeller som er bedst til 128gb memory til lokal hosting
… Den har 128K context-vindue og understøtter chain-of-thought reasoning [1]. TokenMix skriver, at modellen kan køre på en enkelt H100 med 80GB …
elbiler i danmark med 270+ hk, ikke over 550K DKK, og ikke nogen Tesla eller SUV. Lav oversigt med links
… gemma431b_better_than_qwen3627b/) (brief-arkiv) 31. [Ny teknik muliggør long-context finetuning med begrænset VRAM](https://arxiv.org/abs/2607.15105v1) (brief-arkiv)
15 briefing-resultat(er) for »context«
Opfølgning: Brugere søger pi.dev-plugin til konteksthåndtering
En Qwen3.8 27B-bruger på RTX 5080 kæmper med komprimering, der fejler og afslutter modellen tidligt. Se [briefingen 30. august](/archive/2026-08 …
Prompt injection i AI-agenter: omfattende review viser eksploderende angrebsflade
Model Context Protocol (MCP) og agent-systemer åbner for tool poisoning og credential theft. Reviewet dokumenterer reelle hændelser og giver en taksonomi af angreb.
Gammel telefon bliver lokal LLM-server – og MCP-forlængelse overrasker
En XDA-skribent forvandlede sin gamle telefon til en lokal LLM-server og fandt, at MCP (Model Context Protocol) kan udvide en lokal models …
Opfølgning: Qwen 3.8 27B kører 1M kontekst på to RTX 5090'er via NInfer fork
En bruger forked NInfer og tilføjede tensor-parallel og YaRN ×4 rope scaling, så Qwen3.8-27B NVFP4 kører 1.048.576 tokens kontekst …
Opfølgning: Over 200.000 tokens kontekst på 16 GB VRAM med Qwen 3.8 27B
En bruger kører Qwen 3.8 27B med IQ3_XXS-kvantisering og 200k+ kontekst på 16 GB VRAM. Prompt processing falder til 400 tk …
Kan 64k kontekst føles som 300k med rekursive lokale agenter?
En bruger spørger, om man med Qwen 3.8 27B på én GPU kan få en 64k-agent til at håndtere 300k-opgaver via …
Opfølgning: Q8-kvant Qwen 3.8 27B slår BF16 Qwen 3.6 i kodning
Grundig benchmark viser, at Q8 Qwen 3.8 27B overgår BF16 Qwen 3.6 på instruktionsfølgning og 280k kontekst – men har initiale udfordringer med …
UI-Mate: Open-weight GUI-agent sætter ny state-of-the-art på computeropgaver
Tencent præsenterer UI-Mate-27B, der opnår 77% på OSWorld-Verified via in-context demonstrationer.
Opfølgning: DeepSeek-V4-Flash stopper ved 100K+ tokens i OpenCode
Brugere rapporterer, at Q8_K_XL-versionen af DeepSeek-V4-Flash holder op med at generere ved lange kontekster. "Resume" genstarter, men problemet gentager …
Forsigtig kontekststyring personaliserer sprogmodeller uden finjustering
Ny metode, Cautious Context Steering (CCS), lader en let adapter beslutte per token, hvornår brugerkonteksten skal påvirke en frossen model. En enkelt adapter trænet …
Opfølgning: DeepSeek V4 Flash kører med 1M kontekst på en enkelt RTX 5090 + DDR5
En reddit-bruger får fuld 1M kontekst til at køre på en RTX 5090 med 256 GB DDR5 ved hjælp af CPU/RAM-offloading …
Opfølgning: Kimi K3-256k lanceret – 256K kontekstvariant af kæmpemodellen
Moonshot har udgivet Kimi K3-256k med 256K kontekstvindue. Modellen er tilgængelig via API. [Læs den oprindelige brief](/archive/2026-07-19).
Sådan tilføjer du en brugerdefineret MCP-server til Claude og ChatGPT
Simon Willison viser, hvordan man forbinder en MCP-server til standard chat-grænsefladerne – kræver flere trin, men er muligt.
RLVR og GRPO anvendes til molekylær design med LLM'er
Ny forskning anvender Reinforcement Learning with Verifiable Rewards (RLVR) og GRPO til at generere molekyler med specifikke egenskaber. Metoden lover mere præcis lægemiddeldesign.
Ny teknik muliggør long-context finetuning med begrænset VRAM
Hierarchical Global Attention (HGA) kombinerer segment-wise backpropagation og tiered KV-lagring, så kun aktive segmenter forbliver differentiable i VRAM. På Qwin3-8B med …