News-Tracker

Søgning

AI & LLM · daglig briefing


1 briefing-resultat(er) for »x86-vnni«

Opfølgning: llama.cpp 3–3.6x hurtigere på CPU med VNNI-optimering til Q2_0

En ny PR tilføjer AVX-VNNI til Q2_0-dotproduktet i llama.cpp, hvilket giver 8B-modeller 8,2 tok/s mod tidligere 2 …

lørdag 8. august 2026 · Nye modeller llama.cppq2_0x86-vnnicpu-inference