$大胜达(SH603687)$  

激活百万核级存量算力资源,芯瞳攻克 CPU 集群分布式推理难题!

原创 智算视界国芯未来 芯瞳半导体
2026年1月30日 15:02 陕西 1人 星标

近日,芯瞳半导体技术(厦门)有限公司联合联通(陕西)产业互联网有限公司、西安邮电大学,在秦创原创新驱动平台发布"智擎算力云枢(CPU版)"国产化推理解决方案。该方案通过CPU集群分布式推理技术,实现在通用服务器集群上分布式推理32B-70B大参数模型,为AI算力领域提供自主可控的国产化路径。

本次活动以"智算新基座 生态共未来”为主题,聚焦CPU集群大模型产品的创新突破与生态共建,吸引了行业专家、企业代表及媒体人士共计200余人参与。会上,联通(陕西)产业互联网有限公司正式推出"智擎算力云枢(CPU版)”产品,该产品旨在突破传统AI算力对GPU的依赖,通过激活存量CPU算力资源、聚焦核心推理场景,实现算力成本优化与产业平权,为低成本、高效率、可扩展的国产算力路径提供了全新解决方案。



01. AI算力市场的“CPU焦虑”

AI 算力市场呈现GPU/算力卡高度依赖且采购成本高的特征。据中国信通院2025年相关调研,全国存量CPU服务器超300万台,平均利用率不足35%;行业普遍共识显示,GPU采购成本占AI基础设施投入65%以上。

在“无GPU不AI”的行业焦虑下,如何激活海量存量CPU资源、摆脱单一算力架构依赖,成为亟待解决的问题。




02. 三方共绘算力协同发展蓝图

DSC01042.JPG

针对行业痛点,三方代表在会上明确发展方向:陕西联通党委委员、副总经理曹勇军在致辞中表示,联通产互将以“算力+算法+数据”一体化平台为基础,推动算力技术与多场景深度融合,助力陕西培育新质生产力、建设数字强省。

DSC01068.JPG

西安邮电大学副校长巩红指出,学校将依托学科与科研平台优势,为算力技术攻关提供人才与智力支持;未来将持续深化三方合作,打造产学研协同创新标杆,助力算力基础设施高质量发展。

DSC01081.JPG

芯瞳半导体技术(厦门)有限公司联合创始人刘周平,对陕西联通、西安邮电大学的支持表示感谢芯瞳秉持“构建自由算力的文明世界”这一愿景,针对存量CPU资源,与陕西联通基于“化整为零、集群协同”理念,联合推出“智擎算力云枢CPU版”产品,打破AI算力依赖GPU的传统认知,唤醒存量CPU算力价值未来芯瞳将持续推进技术迭代,构建国产化混合算力底座,助力数字经济蓬勃发展。



03. 芯瞳突破大规模CPU集群分布式高效推理难题

在无GPU加速、资源受限的通用CPU服务器上运行32B至70B超大模型,实际应用面临性能瓶颈与稳定性等诸多挑战。

DSC01163.JPG

芯瞳产品总监牛磊现场解析了 “智擎算力云枢” 方案的核心技术突破,该方案可实现 32B 至 70B 参数大模型在通用 CPU 服务器上的高效推理。

通过底层技术优化,针对Ice Lake等主流架构,开展指令集级微架构分析与汇编级内核重构,确保GEMM操作能满载触发AVX-512的计算单元,大幅提升算力利用效率。

在DeepSeek-R1-Distill-Qwen-7B模型下,单机可达14.97 Token/s,四机集群达20 Token/s;70B模型四机集群达4.05 Token/s。测试显示四机集群在性能与能耗比上达到最优平衡,如下图所示:

34fe8845bec753b72af4546b8bd98316.png


与“智擎算力云枢”方案同步亮相的TokenLake应用,由芯瞳负责主导研发,全程完成“云、管、端”全链路技术攻关。该应用具备Win/Mac/Linux全平台原生支持能力,深度集成MCP协议与Agent引擎,算力资源,一键点击即可触达用户桌面。

第一张


第二张


第三张


向右滑动查看更多

此外,西安邮电大学电子工程学院院长杜慧敏教授也从学术与产业融合视角,向现场观众系统阐释了“智擎算力云枢“方案的核心理论架构:

1. 六层协同架构:确保了元任务层对异构 CPU 指令集的兼容性。

2. 任务复杂度感知算法:实现毫秒级资源调度,让简单对话推理加速 20% 以上。

全栈全链路一体化解决方案分层架构图.png




04. 三方启动联合攻关,夯实国产算力底座

此次,芯瞳联合联通产互、西邮启动CPU集群推理技术合作计划,探索通用服务器运行大参数模型的优化路径。三方将从技术、基础设施与场景应用三方面协同发力,深化产学研合作,逐步构建适配国产环境的混合算力方案,为AI应用落地提供更灵活的算力选择。

追加内容

本文作者可以追加内容哦 !