Søgning
2 research-rapport(er) for »fine-tuning«
Qwen 3.8 27b
… unsloth.ai/docs/models/qwen3.6) 7. [Qwen 3.6 27B Fine-Tuning: ThinkingCap Performance - Geeky Gadgets](https://www.geeky-gadgets.com/thinkingcap-local …
Mac Studio M5 hvornår kommer den? båndbredde på hukommelsen? og hvad med rygtet omkring at M6 springes over og de går til M7 i stedet og går efter højere memory båndbredde?
… just-in/thinking-machines-launches-open-weight-inkling-foundation-model-for-fine-tuning/) (brief-arkiv) 20. [M5 Pro vs M5 Max 2026: Apple Silicon …
14 briefing-resultat(er) for »fine-tuning«
Lorivo: Serverless LoRA-hosting på delte GPU'er
Platformen lader mange LoRA-adaptere dele én GPU-server per basismodel og giver OpenAI-kompatible endpoints. Qwen 3.5 4B er gratis.
Opfølgning: Ny forskning adskiller offentlige og private kapaciteter i åbne vægte
… Overvågning af fine-tuning og adskillelse af funktioner er nøglen.
2B LLM finjusteret på WhatsApp-chat – 80% menneskelig winrate
En udvikler trænede Qwen 2B på en seks-personers gruppechat. Modellen lærte slang og reaktioner, men mangler dyb forståelse. Cookbook med reproducerbar pipeline på …
Følelseskontrol til Qwen3-TTS via fine-tuning med emotion-tags
En udvikler har fine-tunet Qwen3-TTS med inline emotion-tags, så modellen kan styre tonefald direkte i transskriptionen. Resultatet er en TTS-model …
450M VLM finetunet på 50.000 browserscreenshots – fra 1% til 44%
En bruger på r/LocalLLaMA deler resultater af at fine-tune en 450M vision-language-model på 50.000 browserscreenshots, hvilket løftede performance fra …
Fintunet Gemma 4 12B giver 2,7x forbedring på tool calling
En bruger fintuner Gemma 4 12B på en enkelt 16 GB GPU og opnår 2,7x forbedring på tool calling samt 15,7 % flere …
Fine-tuning af Cactus Needle 2 matcher DeepSeek v4 på specifikke opgaver
Henry fra Cactus viser, at Needle 2 efter finjustering overgår DeepSeek v4 Flash på afgrænsede opgaver – men advarer mod overfitting.
Praktisk guide: Byg en reasoning-fokuseret LLM med SupraLabs korpus
En tutorial viser komplet workflow fra streaming af data til fine-tuning af SmolLM2-135M med LoRA – en tilgængelig metode til specialiserede små modeller.
Opfølgning: Brugere finjusterer ternære Bonsai 8B på egen data
PrismML's ternære model kan specialiseres via finjustering, men kræver en speciel llama.cpp-fork. Se [briefingen 17. juli](/archive/2026-07-17).
Thinking Machines' bedste Tinker-resultat brugte Qwen3-235B, ikke Inkling
Finjustering af Qwen3-235B opnåede 84,7 % nøjagtighed på finansopgaver til 13,8x lavere pris. Inkling som base-model er endnu ikke offentligt bevist.
Tutorial: Finjustér Qwen3 med LoRA på én GPU i Google Colab
MarkTechPost viser en komplet workflow med NVIDIA NeMo AutoModel, der lader dig træne Qwen3-0.6B på en enkelt GPU. Nyttig guide for alle …
Opfølgning: Thinking Machines Lab lancerer Inkling – en alsidig open-weight-basismodel
Inkling er ikke den stærkeste model, men designet som en bred, balanceret foundation-model til finjustering. Se [briefingen 17. juli](/archive/2026-07-17).
Ny teknik muliggør long-context finetuning med begrænset VRAM
Hierarchical Global Attention (HGA) kombinerer segment-wise backpropagation og tiered KV-lagring, så kun aktive segmenter forbliver differentiable i VRAM. På Qwin3-8B med …
NVIDIA NeMo Automodel og 🤗 Diffusers til skaleret finetuning
NVIDIA har udgivet en guide til at finetune video- og imagemodeller i stor skala ved hjælp af NeMo Automodel integreret med Hugging Face Diffusers.