News-Tracker

Søgning

AI & LLM · daglig briefing


2 briefing-resultat(er) for »int8«

Hvorfor ser vi ikke flere INT8 W8A8-modeller til RTX 3090?

RTX 3090 har native INT8-tensorcores, men de fleste vælger FP8 eller mindre kvanter – debatten om hvorfor fortsætter.

onsdag 2. september 2026 · Forskning & arkitektur rtx-3090int8w8a8quantization

Opfølgning: Qwen3.8-27B når 381 tps på RTX 3090 med nye optimeringer

Bruger opnår 382 tps ved at forlænge verify-blokke og bruge int8 KV-cache. [briefingen 20. august](/archive/2026-08-20).

fredag 21. august 2026 · Værktøjer & produkter qwen-3.8inference-optimizationrtx-3090tps