Søgning
1 research-rapport(er) for »multimodal-llm«
Qwen 3.8 27b
… Qwen3.6-27B er en multimodal model, der accepterer tekst, billeder og video [2], og den er udgivet under Apache 2.0-licensen [2 …
2 briefing-resultat(er) for »multimodal-llm«
Opfølgning: 14 nye papirer kortlægger jailbreak-landskabet – fra multi-turn til forsvar
En række nye forskningsartikler systematiserer multi-turn jailbreak-angreb mod multimodale LLM'er og præsenterer forsvar som TRYLOCK og Attention Slipping. Angrebene udnytter, at …
Synsmodel trænes til at se som en menneskelig annotator – og afsløres når den lyver
Microsofts pipeline udtrækker struktureret metadata fra visuelle aktiver, begrænser output til foruddefinerede værdier og bruger en ground-truth-evaluering til at måle kvalitet.