Googles TurboQuant komprimiert den KV-Cache großer Sprachmodelle auf 3 Bit. Tests auf einer AMD-Karte zeigen: Das Kernversprechen stimmt — mit Nebeneffekten.
Back to Technology
Technology
August 13, 2026 at 10:00 AM
heise+ | Googles TurboQuant-Verfahren: Praxistest auf einer AMD-GPU
Heise