News-Tracker

Søgning

AI & LLM · daglig briefing


1 research-rapport(er) for »yarn«

Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1

… token kontekstudvidelse, der kan udvides til omkring en million tokens via YaRN, samt den nye "Thinking Preservation"-mekanisme. Sammenlignet med konkurrenterne har Qwen 3 …

fredag 7. august 2026 · research

2 briefing-resultat(er) for »yarn«

Opfølgning: NInfer-fork skubber 555k kontekst på en enkelt 5090

Ny fork leverer 555k kontekst i FP4 på en RTX 5090 med NVFP4 KV-cache, Hadamard-rotation og YaRN – 45 % mindre VRAM uden kvalitetstab …

søndag 6. september 2026 · Forskning & arkitektur tinkerkv-cacheyarnqwen-3.8

Opfølgning: Qwen 3.8 27B kører 1M kontekst på to RTX 5090'er via NInfer fork

En bruger forked NInfer og tilføjede tensor-parallel og YaRN ×4 rope scaling, så Qwen3.8-27B NVFP4 kører 1.048.576 tokens kontekst …

søndag 30. august 2026 · Værktøjer & produkter qwen-3.8tinker1m-contextrtx-5090