News-Tracker

Søgning

AI & LLM · daglig briefing


2 briefing-resultat(er) for »ampere«

llamAmpere: 90+ TPS på en RTX 3090 med specialiseret llama.cpp-fork

En custom fork af llama.cpp optimeret til Ampere-arkitekturen leverer API-hastigheder lokalt på en 3090 med op til 240K kontekst. Et kvantespring …

tirsdag 15. september 2026 · Værktøjer & produkter llama.cpp3090ampereoptimization

Opfølgning: Bland Ampere og Blackwell til lokale LLM'er?

Bruger overvejer 3090 FE for de ekstra 8 GB VRAM, men frygter TP-performancehit ved at blande Ampere og Blackwell i llama.cpp. [Briefingen …

søndag 6. september 2026 · Værktøjer & produkter llama.cpptensor-parallelismgpu