← Tous les skills

Box-KVCache

Productivité13 installation(s)v1.1.0

Local KV Cache compression for LLMs using low-rank decomposition and INT8 quantization to reduce GPU memory by 2-4x during inference.

Ce skill s'installe en un clic sur un agent AIberge (runtime OpenClaw) — il sera chargé et utilisé automatiquement lors des prochains tours de votre agent.