News-Tracker

Søgning

AI & LLM · daglig briefing


2 research-rapport(er) for »fine-tuning«

Qwen 3.8 27b

… unsloth.ai/docs/models/qwen3.6) 7. [Qwen 3.6 27B Fine-Tuning: ThinkingCap Performance - Geeky Gadgets](https://www.geeky-gadgets.com/thinkingcap-local …

mandag 3. august 2026 · research

Mac Studio M5 hvornår kommer den? båndbredde på hukommelsen? og hvad med rygtet omkring at M6 springes over og de går til M7 i stedet og går efter højere memory båndbredde?

… just-in/thinking-machines-launches-open-weight-inkling-foundation-model-for-fine-tuning/) (brief-arkiv) 20. [M5 Pro vs M5 Max 2026: Apple Silicon …

onsdag 22. juli 2026 · research

14 briefing-resultat(er) for »fine-tuning«

Lorivo: Serverless LoRA-hosting på delte GPU'er

Platformen lader mange LoRA-adaptere dele én GPU-server per basismodel og giver OpenAI-kompatible endpoints. Qwen 3.5 4B er gratis.

søndag 13. september 2026 · Værktøjer & produkter loravllmserverlessfine-tuning

2B LLM finjusteret på WhatsApp-chat – 80% menneskelig winrate

En udvikler trænede Qwen 2B på en seks-personers gruppechat. Modellen lærte slang og reaktioner, men mangler dyb forståelse. Cookbook med reproducerbar pipeline på …

lørdag 12. september 2026 · Værktøjer & produkter fine-tuning2b-modelwhatsapplocal-llm

Følelseskontrol til Qwen3-TTS via fine-tuning med emotion-tags

En udvikler har fine-tunet Qwen3-TTS med inline emotion-tags, så modellen kan styre tonefald direkte i transskriptionen. Resultatet er en TTS-model …

torsdag 10. september 2026 · Forskning & arkitektur qwen3-ttsemotion-controlfine-tuningtts

450M VLM finetunet på 50.000 browserscreenshots – fra 1% til 44%

En bruger på r/LocalLLaMA deler resultater af at fine-tune en 450M vision-language-model på 50.000 browserscreenshots, hvilket løftede performance fra …

mandag 24. august 2026 · Forskning & arkitektur fine-tuningvlmbrowser-screenshots450m

Fintunet Gemma 4 12B giver 2,7x forbedring på tool calling

En bruger fintuner Gemma 4 12B på en enkelt 16 GB GPU og opnår 2,7x forbedring på tool calling samt 15,7 % flere …

søndag 23. august 2026 · Værktøjer & produkter gemma-4-12bfine-tuningtool-callinglocal-llm

Fine-tuning af Cactus Needle 2 matcher DeepSeek v4 på specifikke opgaver

Henry fra Cactus viser, at Needle 2 efter finjustering overgår DeepSeek v4 Flash på afgrænsede opgaver – men advarer mod overfitting.

fredag 21. august 2026 · Værktøjer & produkter cactus-needle-2fine-tuningdeepseek-v4benchmark

Praktisk guide: Byg en reasoning-fokuseret LLM med SupraLabs korpus

En tutorial viser komplet workflow fra streaming af data til fine-tuning af SmolLM2-135M med LoRA – en tilgængelig metode til specialiserede små modeller.

lørdag 15. august 2026 · Forskning & arkitektur fine-tuningreasoning-corpussupralabslora

Opfølgning: Brugere finjusterer ternære Bonsai 8B på egen data

PrismML's ternære model kan specialiseres via finjustering, men kræver en speciel llama.cpp-fork. Se [briefingen 17. juli](/archive/2026-07-17).

søndag 19. juli 2026 · Forskning & arkitektur ternary-modelsbonsaifine-tuningprism-ml

Thinking Machines' bedste Tinker-resultat brugte Qwen3-235B, ikke Inkling

Finjustering af Qwen3-235B opnåede 84,7 % nøjagtighed på finansopgaver til 13,8x lavere pris. Inkling som base-model er endnu ikke offentligt bevist.

søndag 19. juli 2026 · Forskning & arkitektur thinking-machines-labtinkerqwen3-235bfine-tuninginkling

Tutorial: Finjustér Qwen3 med LoRA på én GPU i Google Colab

MarkTechPost viser en komplet workflow med NVIDIA NeMo AutoModel, der lader dig træne Qwen3-0.6B på en enkelt GPU. Nyttig guide for alle …

søndag 19. juli 2026 · Værktøjer & produkter qwen3loranemo-automodelfine-tuning

Opfølgning: Thinking Machines Lab lancerer Inkling – en alsidig open-weight-basismodel

Inkling er ikke den stærkeste model, men designet som en bred, balanceret foundation-model til finjustering. Se [briefingen 17. juli](/archive/2026-07-17).

lørdag 18. juli 2026 · Nye modeller inklingthinking-machines-labopen-weightsfine-tuning

Ny teknik muliggør long-context finetuning med begrænset VRAM

Hierarchical Global Attention (HGA) kombinerer segment-wise backpropagation og tiered KV-lagring, så kun aktive segmenter forbliver differentiable i VRAM. På Qwin3-8B med …

fredag 17. juli 2026 · Forskning & arkitektur long-contextfine-tuninghgavram-optimization

NVIDIA NeMo Automodel og 🤗 Diffusers til skaleret finetuning

NVIDIA har udgivet en guide til at finetune video- og imagemodeller i stor skala ved hjælp af NeMo Automodel integreret med Hugging Face Diffusers.

fredag 17. juli 2026 · Værktøjer & produkter nvidia-nemodiffusersfine-tuningscalability