Søgning
1 research-rapport(er) for »model-weights«
Qwen 3.8 27b
… Qwen 3.8-Max og 27B-model lanceres – open weights på vej](https://www.reddit.com/r/LocalLLaMA/comments/1ve02j9/qwen_38_is_live …
50 briefing-resultat(er) for »model-weights«
Xi præsenterer open-source AI til BRICS – samtidig med Trumps afvisning
… Kina overvejer samtidig eksportkontrol på egne modeller, hvilket skaber et geopolitisk skisma om AI-regulering.
Agnes-3.0-Flash: Benchmark-hit med uklar historie
33B-modellen hævdes at slå Qwen3.8 27B på AA-indekset, men HF-udgaven er "Preview" og ikke samme model som evalueret.
Opfølgning: Ny forskning adskiller offentlige og private kapaciteter i åbne vægte
To nye papirer foreslår metoder til at kontrollere sensitive kapaciteter i open-weight-modeller uden at forhindre forskning. [briefingen 29. august](/archive/2026-08 …
Opfølgning: Åbne vægte ≠ open source – og det betyder noget nu i bestyrelseslokalet
Enterprise-valget mellem lukkede og open-weight-modeller er ikke sort/hvidt. Artiklen forklarer, hvorfor open source-definitionen og risikostyring er blevet et bestyrelsesspørgsmål …
Åbne modeller bliver et redskab for kinesisk statskunst
Strategisk analyse advarer om, at Beijing med vilje bruger open-weight-modeller til at udbrede kinesisk AI-standarder og påvirkningskapacitet globalt.
DeepSeek V4.1 Flash er 748B parametre – ikke 284B
Reddit-undersøgelse af safetensors-filerne afslører sande paramettertal: 552B i basismodellen, 748B med engram og vision-encoder. Kræver markant mere hardware end antaget.
Muse-Glimmer-30B overrasker med kreativ skrivekunst
Den lille 30B-model slår langt større frontier-modeller i EQ-Bench Creative Writing og leverer ægte morsom David Sedaris-parodi.
Opfølgning: IFM udgiver seks åbne K2 Horizon-modeller fra 0,9B til 375B
IFM har frigivet seks Apache 2.0-modeller inklusive 375B-A23B og 0,9B, sammen med præ-træningskorpus og checkpoints. Flåden er blandt de …
Qwen 3.8 Flash Next Max: stærk til samtale
Brugere oplever, at modellen kender overraskende detaljer om lokale forhold og kaster sig helhjertet over problemer – uden de sædvanlige hallucinationer.
IFM frigiver verdens største flåde af fuldt åbne AI-modeller
MBZUAI's Institute of Foundation Models udgiver seks K2 Horizon-modeller fra 0,9B til 375B parametre med vægte, kode, træningsdata og metodik under …
Sanders vil forbyde AI og true med 20 års fængsel
… Forslaget viser en voksende politisk vilje til hårde indgreb – også mod open-weights-modeller.
UAE's K2 Horizon udfordrer de lukkede labs med fuld åbenhed
WIRED fremhæver, at MBZUAI's seks modeller er mere end open-weights: træningsdata, kode og metodik er offentlige. Det er et modsvar til global …
Opfølgning: OpenAI styrker sikkerhed efter Hugging Face-brud
OpenAI har offentliggjort en rapport, der beskriver forbedret sandboxing, beskyttelse af modelvægte og overvågning af AI-agenters værktøjsbrug for at forhindre uautoriseret adgang. [Se …
Tencent Hy4 Preview: 770B parametre, 49B aktive, 1M kontekst
… Simon Willison noterer, at modellen kun har to reasoning-effort-niveauer: "high" og "no_think".
Open source AI: befrier eller trussel? Debatten blusser
… lukkede modeller. Spændingen mellem frihed og sikkerhed tilspidses.
Opfølgning: Zhipu afslører Ox Alpha som GLM-5.3-Flash og udgiver vægte
… aktive) – den første native multimodale model i GLM-5-serien. Vægtene er nu frit tilgængelige. [briefingen 14. august](/archive/2026-08-14)
Opfølgning: Z.ai bekræfter, at Ox Alpha er GLM-5.3-Flash – open-sourcer modellen
Det kinesiske laboratorium Z.ai afslørede sig som skaberen af den mystiske Ox Alpha-model og udgav den som GLM-5.3-Flash med …
Opfølgning: Alibaba udgiver Qwen3.8-Flash-Next som forhåndsvisning af Qwen4-arkitekturen
Den nye 125B MoE-model med 6B aktive parametre er multimodal og giver et tidligt indblik i Qwen4. Modellen bygger videre på Qwen3.8 …
GLM-5.3-Flash: 320B parametre, 1M kontekst og hybrid attention
Den officielle megatråd bekræfter, at modellen har 320B parametre (18B aktive), 1M tokens kontekstvindue og en ny hybrid sparse/linear attention. Den er trænet …
IBM udgiver Granite 4.2 med indbygget ræsonnement og agentisk RL
De nye open-source-modeller (3B, 8B, 30B) har en tænk/lav-indsats/ikke-tænk-kontakt og værktøjsbrug. 8B og 30B er trænet med …
Opfølgning: Hugging Face-hack afslører paradoks i open-weight-sikkerhed
Efter angreb måtte Hugging Face ty til kinesiske open-weight-modeller, da kommercielle modellers guardrails blokerede forsvaret. [briefingen 25. august](/archive/2026-08-25)
Apodex 1.1: 35B-agentmodel, der matcher frontløbere
Apodex 1.1 (35B parametre) klarer sig på niveau med langt større systemer på komplekse opgaver – Mini-versionen er lokalt deployerbar.
Opfølgning: Qwen 3.8 27B er "en game changer" – overgår Gemini 3.5 Flash Lite til OCR
… Modellen matcher frontier-modeller fra for et år siden og får teams til at overveje egen hardware, da investeringen kan tjene sig hjem på …
dots3-note preview: første open-weight model i familien – 280B parametre
En MoE-model med 16B aktive parametre, 512K kontekst og forståelse af tekst, billeder, video og lyd. Pull request indsendt til llama.cpp.
Opfølgning: Ornith-1.5-familien slår Claude Opus 4.8 på flere benchmarks
Ornith-1.5 fås i 9B, 35B MoE og 397B MoE og opnår state-of-the-art blandt open-source modeller. Modellerne er selvforbedrende …
Kinesiske AI-modeller splitter Silicon Valley – USA truer med sanktioner
USAs finansminister truer Kina med sanktioner, mens debatten om, hvorvidt kinesiske modeller er kopieret, skærpes. Det reelle kapløb handler om diffusion, ikke superintelligens.
AntLing open-sourcer base-modeller for Ling-3.0-tiny og flash
… Ling-3.0-tiny (7.9B) matcher større modeller på kode, og flash (124B) klarer sig godt på ræsonnement og lange kontekster.
Opfølgning: Z.AI's GLM-5.3 overgår amerikanske modeller i cybersikkerhed – udgivelse forsinket
Det kinesiske open-weight-model GLM-5.3 slår benchmarks, men udgivelsen er udskudt efter uventede hacking-evner. [briefingen 11. august](/archive/2026-08 …
Opfølgning: Alibaba lover nyt Qwen 3.8 open-weight-model i næste uge
Community manager bekræfter en mellemstor model over 100B parametre uden early access. [briefingen 8. august](/archive/2026-08-08)
Qwen 3.8 27B matcher GPT-5.6 Luna – på en brøkdel af parametrene
… Det cementerer den lille åbne model som en af de mest imponerende udgivelser i år.
Opfølgning: Amodei: Open weights decentraliserer ikke magten alene
Anthropic CEO Dario Amodei argumenterer for at open-weight-modeller ikke er nok til at bryde cloud- og hardwaregiganternes greb. Startups forbliver afhængige af …
Opfølgning: GLM-5.3 lanceret med 50% bedre kodning og cyber-capabilities
Z.ai's nye open-weight model GLM-5.3 hævdes at være "den hidtil dygtigste" til cybersecurity-opgaver, med 50% forbedring i kodning …
Dario Amodei: Open weights decentraliserer ikke magt – kræver pre-launch-vetting
Amodei forsvarer sine politiske forslag og advarer om, at open-weight-modeller ikke automatisk spreder magten. Han støtter i stedet forhåndsgodkendelse før udgivelse og …
Opfølgning: Qwen 3.8-distillationer dukker op – mindre modeller fra den store
Distillerede varianter af Qwen 3.8-2.4T er begyndt at cirkulere, hvilket lover godt for lokale kørsler. Se [briefingen 13. august](/archive/2026 …
Opfølgning: Qwen runder 3 milliarder downloads – forbi Meta og Google
Alibabas Qwen-familie er nu downloadet over tre milliarder gange, med 460+ modeller og 300.000 afledte varianter. Økosystemets størrelse cementerer Alibabas rolle, som …
Opfølgning: Qwen3.8-27B matcher Claude 4.6 fra for seks måneder siden
… En 27B open-weight-model tæt på seks måneder gammel frontier viser, hvor hurtigt kløften lukkes – se [briefingen 5. august](/archive/2026-08-05).
Opfølgning: GLM-5.3 lanceret som 743-milliarder-parameter open-weights-model
Z.ai har lanceret GLM-5.3, en 743-milliarder-parameter open-weights-kodemodel, og vægtene kommer snart på Hugging Face. Udfordringen til de …
Opfølgning: Qwen3.8-27B udkom trods frygt for aflyst drop
Udgivelsen af Qwen3.8-27B blev fulgt tæt i fællesskabet, hvor brugere fandt en ModelScope-liste med nedtælling dagen før. Frygten for en aflyst …
Debat: Google bør udgive 120B multimodalt Gemma for at presse OpenAI og Anthropic
Debatten peger på, at vestlige virksomheder ikke vil bruge kinesiske modeller – et åbent, næsten-frontier Gemma ville presse OpenAI og Anthropic før deres børsnoteringer …
Opfølgning: Qwen 3.8 benchmarks viser stærk konkurrenceevne
… 8-Max og 27B matcher eller slår konkurrenter på flere tests. Modellen er tilgængelig via API og som open-weight. [briefingen 4. august](/archive …
Ling 3.0 Flash: Den hidtil bedste åbne model i sin størrelse
… Det styrker argumentet for, at åbne modeller kan matche lukkede på ydeevne.
Opfølgning: DeepSeek V4-Pro 0813 er ude – men forsvandt kortvarigt
DeepSeek lancerede V4-Pro i dag, men modellen blev midlertidigt fjernet fra Hugging Face. Communityet spekulerer i tekniske problemer eller licensjusteringer. Se [briefingen 8 …
Opfølgning: Nvidia lancerer Nemotron 3.5 Lightning og varsler trillion-parameter Nemotron 4
Nvidia har udgivet Nemotron 3.5 Lightning, en 30B open-weight MoE-model til agentiske opgaver, og bekræfter planer om Nemotron 4 med op …
Opfølgning: DeepSeek V4 Pro 0813 ude på OpenRouter – ingen officiel annoncering
DeepSeek har stille lanceret V4 Pro 0813 via API, uden pressemeddelelse eller bekræftelse af open weights. Modellen viser markant forskellige resultater på tværs af …
Opfølgning: Qwen 3.8-2.4T-A95B udgivet – 2,4 trillion parameter MoE-model
Alibaba har stille frigivet Qwen3.8-2.4T-A95B på Hugging Face, en massiv MoE-model med 95B aktive parametre. Udgivelsen bekræfter Qwen-familiens …
Muse Glimmer 30B: Metas åbne superintelligens-tåge letter – og aktiemarkedet trækker på skuldrene
… Mark Zuckerberg udgav mandag et manifest for distribueret superintelligens, samtidig med at Meta frigav det åbne 30B-parameter agent-model Muse Glimmer, der kører …
LTX-2.5: Open-weight videomodel genererer 10 sekunder fra ét billede på 6,8 sekunder på Nvidia-superchips
LTX, spin-off fra Lightricks, frigav LTX-2.5, en open-weight "world model" der er nativt integreret i ComfyUI. Modellen kan generere 10 …
Qwen 3.8-27B bekræftet til udgivelse i denne uge – Qwednesday stunder til
… Open-weight-fællesskabet venter spændt på en ny stærk model til lokal inferens. Se [briefingen 4. august](/archive/2026-08-04).
De små åbne modeller er mere skræmmende for OpenAI end de store – argumenterer Reddit-fællesskabet
En diskussion på r/LocalLLaMA argumenterer for, at tippepunktet, hvor en bærbar kan køre en model, der klarer 90 % af ens arbejde, vil sprænge …
Muse Glimmer: Metas 30B open-weight agent-model kører på én GPU
Meta udgav Muse Glimmer, en 30B open-weight model under Apache 2.0, optimeret til lokale agent-workflows på én consumer GPU. Modellen klarer …