KVCache4bit量化落地,SGLang在Blackwell上实现1.78倍上下文与+78%解码 SGLang团队联合阿里云Qwen与NVIDIA,在Blackwell平台实现KV Cache从FP8到NVFP4(4bit浮点)的量化,显著提升长上下文处理能... 2026年09月24日 人工智能 #KV cache #FP8 分享海报
Imagination推出多精度矩阵乘加速器,AI算术性能提升33% 近日,图形处理器制造商 Imagination Technologies 宣布推出其新一代 E-Series GPU 中的一项关键技术突破:一种能够高效支持多种... 2026年08月07日 半导体/芯片 #FP8 #INT8 分享海报