News-Tracker

Søgning

AI & LLM · daglig briefing


2 briefing-resultat(er) for »prs«

50 PRs fra hurtigere CPU-inference i llama.cpp

En liste over åbne PRs til llama.cpp viser massiv aktivitet omkring CPU/RAM/hybrid-optimering: AVX-512, MoE expert-caching, streamede vægte og …

søndag 30. august 2026 · Værktøjer & produkter llama.cppcpu-inferenceoptimizationprs

Status på 1-bit og ternære modeller: Bonsai, Hy-MT1.5, Maple-Preview og flere

En omfattende opdatering dækker nye PRs for CUDA/Vulkan og optimeringer, der giver 15-40% hastighedsforøgelse.

onsdag 19. august 2026 · Forskning & arkitektur bitnetternarybonsaiquantization