Søgning
3 research-rapport(er) for »gemma-4«
Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1
# Qwen 3.6 27B sammenlignet med Gemma 4 og Laguna 2.1 til lokal kørsel ## Hvad kilderne siger Qwen 3.6 27B fremhæves bredt …
Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1
… Gemma 4 12B versus Qwen 3.6 coding claim · GitHub](https://gist.github.com/magnus919/178c2f4fb6513ec74d977fe7213f33da) 4. [Gemma 4 26B A4B vs Qwen3.6 …
elbiler i danmark med 270+ hk, ikke over 550K DKK, og ikke nogen Tesla eller SUV. Lav oversigt med links
… 585 hk, 4WD, 424 km rækkevidde. Medtages med forbehold for brugerens SUV-definition. | | **Nio ET5 (489 hk)** | 489 hk [15] | 449.900 kr. [15 …
16 briefing-resultat(er) for »gemma-4«
Upcycling af Gemma4-12B til MoE – bruger kræver officiel 124B-model
En hobbyist har med succes upcyclet Googles Gemma4-12B til en MoE-model ved at tilføje 4 eksperter, og opfordrer Google til at udgive …
Open-source TTS-pipeline med Gemma4 og IndexTTS 2.5
En bruger har bygget en pipeline, der bruger Claude Code, Gemma4 til historie, IndexTTS 2.5 til stemmer og Whisper til kvalitetskontrol, med web …
Open-weight VLM'er matcher Gemini på egocentrisk data – 19x billigere
Gemma 4 26B og Qwen 3.8 27B scorer tæt på Gemini 2.5 Flash i hånd-synlighedsanalyse. Forskellen er pris og muligheden for …
AWS g6 leverer 3,7x throughput vs. g5g til LLM-serving
Gemma 4 E2B i ren JAX på g6.2xlarge vs. g5g.2xlarge. Den ældre instans mister 87% af decode-tiden til dtype-konvertering – uden …
Opfølgning: gemma4.c – en moderne LLM på 700 linjer C, hurtigere end llama.cpp
En udvikler har skrevet en komplet inferens-runtime til Gemma 4 E2B i 700 linjer C. På en Ryzen 7 7700 opnås 639 tok …
Fintunet Gemma 4 12B giver 2,7x forbedring på tool calling
En bruger fintuner Gemma 4 12B på en enkelt 16 GB GPU og opnår 2,7x forbedring på tool calling samt 15,7 % flere …
Opfølgning: Tensor-kvantisering bevarer 96,7 % af Gemma 4 E4B's ræsonnement ved IQ2_XXS
Med IQ2_XXS og tensor-allokeret præcision steg reasoning fra 28,9 til 69,5 under samme 3,3 GB-budget – uden post-træning …
Opfølgning: Tokenisering afslører Qwens kode-fordel over Gemma
Samme kode på 330 linjer blev til 1609 tokens i Qwen 35B mod 4258 i Gemma 26B. Qwen behandler kode som et specifikt inputformat …
Sammenligning af 4-bit kvanttyper på MLX i gang
Brugeren efterlyser erfaringer med OptiQ, Unsloth Dynamic 2.0, oQ og DWQ til Qwen3.6 og Gemma4 på MLX – hvilken kvant bevarer bedst kvalitet?
Opfølgning: Gemma 4 QAT er ikke entydigt bedre end Q4_K_L
Omfattende benchmarks viser, at Googles QAT-kvantisering sparer hukommelse, men taber i præcision på visse opgaver. Brugeren foreslår, at Google justerer modellen til q4 …
Opfølgning: Brugere på r/LocalLLaMA så tvivl om benchmarks – Gemma 4 imponerer i praksis
Flere brugere rapporterer, at Gemma 4 26B klarer sig bedre end Gemini 3.5 Flash og Claude Opus 5 i virkelige opgaver som e …
Opfølgning: Brugere roser Gemma 4 26B for sprog og viden trods mindre agentisk ydeevne
På Reddit fremhæves modellens fremragende tyskkundskaber og brede viden – den kører med 10-23 tokens/sek på en ældre bærbar. [briefingen 19. juli](/archive …
Gemma 4 opdateret – lokalt testet på M5 Pro med OpenCode
Den opdaterede Gemma 4 (26B A4B, Q6) kører med 60 t/s på en Apple M5 Pro og fungerer godt til backendkodning, men UI …
Opfølgning: Qwen 3.6 føles mindre intelligent end Gemma 4 trods bedre benchmarks
Brugere oplever, at Gemma 4 26a4B (QAT) er mere sammenhængende i praksis. Se [briefingen 18. juli](/archive/2026-07-18).
Hvilke oversete lokale modeller bruger du dagligt?
En tråd på r/LocalLLaMA samler anbefalinger af modeller uden for mainstream som Qwen 3.6 og Gemma 4. Tråden afslører flere skjulte perler …
Gemma4-31b slår Qwen3.6-27b som kodningsagent i praksis
En bruger skiftede fra Qwen3.6-27b til Gemma4-31b som primær kodningsagent og løste på én dag bugs, der havde stået på i …