Søgning
6 briefing-resultat(er) for »vlm«
Vision-støtte gør Qwen 3.8 27B til en bedre kodeassistent
Brugere på LocalLLaMA rapporterer, at vision-versionen af Qwen 3.8 27B automatisk tager screenshots for at verificere kode, hvilket reducerer stille fejl. Kører …
Open-weight VLM'er matcher Gemini på egocentrisk data – 19x billigere
Gemma 4 26B og Qwen 3.8 27B scorer tæt på Gemini 2.5 Flash i hånd-synlighedsanalyse. Forskellen er pris og muligheden for …
450M VLM finetunet på 50.000 browserscreenshots – fra 1% til 44%
En bruger på r/LocalLLaMA deler resultater af at fine-tune en 450M vision-language-model på 50.000 browserscreenshots, hvilket løftede performance fra …
Opfølgning: DeepSeek V4 Flash fik basic vision via 40M connector trænet på 100K eksempler
… Resultatet er en fungerende, men ikke produktionsklar, VLM. Se [briefingen 8. august](/archive/2026-08-08).
ASCIITermDraw Bench tester VLM'ers evne til at tegne i ASCII
Ny benchmark med 80 opgaver måler, om vision-sprogmodeller kan generere og redigere ASCII-diagrammer præcist. Opgaver spænder fra netværkstopologi til softwarearkitektur.
reCamera Pro kombinerer computer vision med LLM/VLM på enheden
Seeed Studios nye AI-kamera bruger Rockchip RV1126B med 3 TOPS NPU til on-device vision, men understøtter også LLM, VLM, STT og TTS …