Søgning
3 research-rapport(er) for »gemma«
Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1
# Qwen 3.6 27B sammenlignet med Gemma 4 og Laguna 2.1 til lokal kørsel ## Hvad kilderne siger Qwen 3.6 27B fremhæves bredt …
Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1
… Gemma 4 – lokal kodegenerering ## Hvad der skete Flere kilder sammenligner Alibabas Qwen 3.6 27B-model med Googles Gemma 4-serie i forhold til …
elbiler i danmark med 270+ hk, ikke over 550K DKK, og ikke nogen Tesla eller SUV. Lav oversigt med links
… arkiv) 30. [Gemma4-31b slår Qwen3.6-27b som kodningsagent i praksis](https://www.reddit.com/r/LocalLLaMA/comments/1uz8532/gemma431b_better_than_qwen3627b …
22 briefing-resultat(er) for »gemma«
Upcycling af Gemma4-12B til MoE – bruger kræver officiel 124B-model
En hobbyist har med succes upcyclet Googles Gemma4-12B til en MoE-model ved at tilføje 4 eksperter, og opfordrer Google til at udgive …
Open-source TTS-pipeline med Gemma4 og IndexTTS 2.5
En bruger har bygget en pipeline, der bruger Claude Code, Gemma4 til historie, IndexTTS 2.5 til stemmer og Whisper til kvalitetskontrol, med web …
Opfølgning: Qwen 3.8 27B overgår GPT-5.6 på tysk oversættelse
Brugere rapporterer at Qwen 3.8 27B leverer idiomatisk, nuanceret tysk langt bedre end frontier-modeller. Særligt tegnsætning og ordvalg roses. [briefingen 20. august …
Open-weight VLM'er matcher Gemini på egocentrisk data – 19x billigere
Gemma 4 26B og Qwen 3.8 27B scorer tæt på Gemini 2.5 Flash i hånd-synlighedsanalyse. Forskellen er pris og muligheden for …
AWS g6 leverer 3,7x throughput vs. g5g til LLM-serving
Gemma 4 E2B i ren JAX på g6.2xlarge vs. g5g.2xlarge. Den ældre instans mister 87% af decode-tiden til dtype-konvertering – uden …
Opfølgning: gemma4.c – en moderne LLM på 700 linjer C, hurtigere end llama.cpp
En udvikler har skrevet en komplet inferens-runtime til Gemma 4 E2B i 700 linjer C. På en Ryzen 7 7700 opnås 639 tok …
Fintunet Gemma 4 12B giver 2,7x forbedring på tool calling
En bruger fintuner Gemma 4 12B på en enkelt 16 GB GPU og opnår 2,7x forbedring på tool calling samt 15,7 % flere …
Opfølgning: Tensor-kvantisering bevarer 96,7 % af Gemma 4 E4B's ræsonnement ved IQ2_XXS
Med IQ2_XXS og tensor-allokeret præcision steg reasoning fra 28,9 til 69,5 under samme 3,3 GB-budget – uden post-træning …
Debat: Google bør udgive 120B multimodalt Gemma for at presse OpenAI og Anthropic
Debatten peger på, at vestlige virksomheder ikke vil bruge kinesiske modeller – et åbent, næsten-frontier Gemma ville presse OpenAI og Anthropic før deres børsnoteringer …
Muse Glimmers reasoning traces er kaotiske og repetitive sammenlignet med Qwen og Gemma
Brugere observerer, at Muse Glimmers reasoning-traces er usædvanligt uorganiserede, repetitive og indeholder mærkelige policy-henvisninger. Til gengæld er modellen meget hurtig med DFlash …
Opfølgning: 1B-parameter LLM trænet fra bunden for $200 på 20B tokens
… Arkitekturen er baseret på Gemma3. Se [briefingen 9. august](/archive/2026-08-09).
Opfølgning: Tokenisering afslører Qwens kode-fordel over Gemma
Samme kode på 330 linjer blev til 1609 tokens i Qwen 35B mod 4258 i Gemma 26B. Qwen behandler kode som et specifikt inputformat …
Sammenligning af 4-bit kvanttyper på MLX i gang
Brugeren efterlyser erfaringer med OptiQ, Unsloth Dynamic 2.0, oQ og DWQ til Qwen3.6 og Gemma4 på MLX – hvilken kvant bevarer bedst kvalitet?
Opfølgning: Gemma 4 QAT er ikke entydigt bedre end Q4_K_L
Omfattende benchmarks viser, at Googles QAT-kvantisering sparer hukommelse, men taber i præcision på visse opgaver. Brugeren foreslår, at Google justerer modellen til q4 …
Opfølgning: Brugere på r/LocalLLaMA så tvivl om benchmarks – Gemma 4 imponerer i praksis
Flere brugere rapporterer, at Gemma 4 26B klarer sig bedre end Gemini 3.5 Flash og Claude Opus 5 i virkelige opgaver som e …
Opfølgning: Brugere roser Gemma 4 26B for sprog og viden trods mindre agentisk ydeevne
På Reddit fremhæves modellens fremragende tyskkundskaber og brede viden – den kører med 10-23 tokens/sek på en ældre bærbar. [briefingen 19. juli](/archive …
Gemma 4 opdateret – lokalt testet på M5 Pro med OpenCode
Den opdaterede Gemma 4 (26B A4B, Q6) kører med 60 t/s på en Apple M5 Pro og fungerer godt til backendkodning, men UI …
Opfølgning: Qwen 3.6 føles mindre intelligent end Gemma 4 trods bedre benchmarks
Brugere oplever, at Gemma 4 26a4B (QAT) er mere sammenhængende i praksis. Se [briefingen 18. juli](/archive/2026-07-18).
Tysk SooFi-team lancerer åben MoE-model med Mamba-arkitektur
Soofi S 30B-A3B er en hybrid Mamba–Transformer-model med 30B parametre, målrettet tysk og engelsk. Modellen udkommer som open-source, hvilket styrker …
Hvilke oversete lokale modeller bruger du dagligt?
En tråd på r/LocalLLaMA samler anbefalinger af modeller uden for mainstream som Qwen 3.6 og Gemma 4. Tråden afslører flere skjulte perler …
Gemma4-31b slår Qwen3.6-27b som kodningsagent i praksis
En bruger skiftede fra Qwen3.6-27b til Gemma4-31b som primær kodningsagent og løste på én dag bugs, der havde stået på i …
Længsel efter nye små sprogmodeller
Siden april er der ikke kommet nye udgaver af Gemma eller Qwen, og communityet spørger, hvornår næste bølge af kompakte LLM'er lander.