11月5日配资平台官方网站,据“华为数据存储”微信公众号消息,华为针对AI推理加速的关键技术——UCM(Unified Cache Manager)推理记忆数据管理正式宣布开源。据华为介绍,UCM目前具备四大能力:稀疏注意力、前缀缓存、预填充卸载、异构PD解耦,实现首Token时延最高降低90%配资平台官方网站,系统吞吐最大提升22倍,并达到10倍级上下文窗口扩展。
出彩速配提示:文章来自网络,不代表本站观点。
本文评分*
评论内容*
你的昵称*
你的邮箱*