DeepSeek 致谢腾讯技术团队优化DeepEP通信框架
创始人
2025-05-08 13:20:20
0

环球网科技综合报道】5月8日消息,腾讯技术团队近日针对DeepSeek开源的DeepEP通信框架进行了深度优化,使其在多种网络环境下的性能实现了显著提升,为企业开展AI大模型训练提供了更高效的解决方案。

据测试结果显示,优化后的DeepEP通信框架在RoCE网络环境下的性能提升了100%,而在IB(InfiniBand)网络环境下也实现了30%的性能提升。这一技术突破得到了DeepSeek的公开致谢,被赞誉为一次“huge speedup”的代码贡献。

腾讯星脉网络团队在DeepEP开源后迅速展开技术攻关,针对该框架存在的两大关键瓶颈——双端口网卡带宽利用率不足和CPU控制面交互时延问题,进行了深入研究和优化。经过不懈努力,他们不仅成功解决了这些问题,还使DeepEP在RoCE网络环境下的性能实现了翻倍,同时在IB网络环境下的通信效率也再提升了30%。

目前,这一优化后的技术方案已经全面开源,并成功应用于腾讯混元大模型等项目的训练推理中。在腾讯星脉与H20服务器构建的环境中,这套方案展现出了出色的通用性和稳定性。(纯钧)

相关内容

热门资讯

Mindbeam推开源AI框架... 成立仅两年的初创公司 Mindbeam AI 今日发布了一款名为 Litespark-Inferen...
澳洋顺昌取得背光模组专利提升抬... 国家知识产权局信息显示,淮安澳洋顺昌光电技术有限公司取得一项名为“一种背光模组、显示装置和抬头显示系...
Snap旗下首款面向普通消费者... IT之家 6 月 17 日消息,Snap 今日正式发布首款面向普通消费者的独立式 AR 眼镜 Sna...
以后的新能源车,没电就没刹车了... 最近脖子哥听到一种离谱的声音,说是改装店的天塌了。。。 原因是最近理想 L9 Livis 开始使用全...
原创 有... 作者|雨谷 声明|题图来源于网络。惊蛰研究所原创文章,如需转载请留言申请开白。 近期,钉钉ONE项目...
当MAXHUB做生态、华为做安... 中国云会议市场正在经历一场微妙的预期重构。 IDC曾预测2024年市场规模突破百亿,而终局数据定格在...
高通CEO:正研发超40款AI... 高通首席执行官克里斯蒂亚诺·阿蒙(Cristiano Amon)近日透露,公司正在研发超过40款新型...
顺德发布人工智能赋能数字政府三... 到2028年底,顺德要打造一批可复制、可推广的“AI+数字政府”场景应用。近日,顺德区政务服务和数据...
卓兆点胶获得发明专利授权:“稳... 证券之星消息,根据天眼查APP数据显示卓兆点胶(920026)新获得一项发明专利授权,专利名为“稳定...
中国生物医学工程学会用一场挑战... 穿戴设备如何精准识别本人与非本人使用?如何自动识别运动类型?如何无感监测血压变化,实现高血压疾病的提...