DeepSeek又一论文上新
创始人
2026-02-27 21:01:45

钛媒体App 2月27日消息,在业界对新一代旗舰模型DeepSeek V4的翘首期盼中,DeepSeek团队却悄然放出了一篇新的学术论文。这篇论文由DeepSeek联合北大、清华共同撰写,将研究方向投向了决定大模型实际应用落地的关键一环——推理速度,为日益复杂的AI智能体,提供一套高效的底层系统解决方案。具体来说,新论文介绍了一个名为DualPath的创新推理系统,专门针对智能体工作负载下的大模型(LLM)推理性能进行优化。通过引入“双路径读取KV-Cache(类似记忆缓存)”机制,重新分配存储网络负载,将离线推理吞吐量最高提升1.87倍,在线服务的每秒智能体运行数平均提升1.96倍。论文在引言部分提到,大模型正从单轮对话机器人和独立推理模型,快速演进为智能体系统 ——能够自主规划、调用工具,并通过多轮交互解决实际任务。这种应用范式的转变,推动大模型推理工作负载发生重大变革:从传统的人类-大模型交互,转向人类-大模型-环境交互,交互轮次可达数十甚至数百轮。(第一财经)

相关内容

热门资讯

5G七载·破局新生 | 5G从... 2019年6月6日,中国正式发放5G牌照。历经七载深耕细作,在“十五五”开局之年,中国通信行业交出了...
星空有约|6月9日起精彩天幕“... 6月9日开始,“天幕剧场”将上演多场热闹的天体“盛会”。届时,金星、木星、水星、月亮等天体将在黄昏西...
星派自动化取得夹抱式装箱机构专... 国家知识产权局信息显示,上海星派自动化股份有限公司取得一项名为“一种夹抱式装箱机构”的专利,授权公告...
微软MAI模型宣传存出入,混用... 6月6日消息,科技媒体The Decoder于6月5日发布博文称,微软最新发布的MAI系列AI模型部...
6月9日起精彩天幕“连续剧”将... 6月9日开始,“天幕剧场”将上演多场热闹的天体“盛会”。届时,金星、木星、水星、月亮等天体将在黄昏西...