DeepSeekV4.1-Flash如何将KVCache压缩至890字节/token DeepSeek 发布 V4.1-Flash 模型,通过架构优化和存储调度,将全局 KV 缓存从 3514 字节/token 压缩至 890 字节/token,... 2026年09月14日 人工智能 #KV cache #DeepSeek V4.1-Flash