Ist die Lokale KI langsam? Das Modell liest mehr, als der Speicher liefert. Warum VRAM, Quantisierung und KV-Cache das Tempo bestimmen und...