问鼎娱乐-创意平台,注册畅享文化之梦!

在同等延迟约束下,系统吞吐达到各芯片原生算子库的 90% 以上星耀国际APP,实现性能与适配效率的双重优化。

问鼎娱乐

IT之家注:中国电信研究院是中国电信集团下属研发机构,聚焦 6G、光网络、卫星通信等领域核心技术攻关。

广告声明:文内含有的对外跳转链接(包括不限于超链接、二维码、口令等形式),用于传递更多信息,节省甄选时间,结果仅供参考,IT之家所有文章均包含本声明。

]article_adlist-->  声明:新浪网独家稿件,未经授权禁止转载。 -->

本次技术验证已完成 10 余款主流开源模型在三类芯片上的端到端推理测试星耀国际APP,核心指标表现优异:

此外,框架内置的 benchmark 与 Profiling 工具可一键生成跨芯性能对比报告,为业务方提供选芯决策支撑。

平均迁移时间≤3 天,较传统适配模式效率提升超 80%;

精度误差 < 0.5%,确保模型推理可靠性;

中国电信研究院牵头启动“Triton 统一跨架构推理框架”技术攻关,通过自研 Triton 跨架构编译器与统一大模型算子库,实现同一套算子源码在英伟达、昇腾、沐曦三类芯片上无缝运行。

IT之家 12 月 12 日消息,据通信产业网今日报道星耀国际APP,中国电信研究院联合中国科学院计算技术研究所、华为昇腾、沐曦等,依托中国电信云网融合技术中试验证平台,成功完成业界首个面向国产算力的跨架构大模型推理技术验证。