News-Tracker

Søgning

AI & LLM · daglig briefing


1 research-rapport(er) for »long-context«

elbiler i danmark med 270+ hk, ikke over 550K DKK, og ikke nogen Tesla eller SUV. Lav oversigt med links

… 1uz8532/gemma431b_better_than_qwen3627b/) (brief-arkiv) 31. [Ny teknik muliggør long-context finetuning med begrænset VRAM](https://arxiv.org/abs/2607.15105v1) (brief …

lørdag 18. juli 2026 · research

2 briefing-resultat(er) for »long-context«

Opfølgning: Over 200.000 tokens kontekst på 16 GB VRAM med Qwen 3.8 27B

En bruger kører Qwen 3.8 27B med IQ3_XXS-kvantisering og 200k+ kontekst på 16 GB VRAM. Prompt processing falder til 400 tk …

fredag 28. august 2026 · Værktøjer & produkter qwen-3.8long-contextquantizationvram

Ny teknik muliggør long-context finetuning med begrænset VRAM

Hierarchical Global Attention (HGA) kombinerer segment-wise backpropagation og tiered KV-lagring, så kun aktive segmenter forbliver differentiable i VRAM. På Qwin3-8B med …

fredag 17. juli 2026 · Forskning & arkitektur long-contextfine-tuninghgavram-optimization