英特尔新CPU发布之后,AI计算的格局要变了

英特尔在自己最擅长的 CPU 上完成了一次 AI 计算的革新。

人工智能技术改变了我们的生活,而说到 AI 背后的算力,人们经常会先想到 GPU。从 2019 年英特尔为其第二代至强可扩展处理器增添了内置的深度学习加速技术后,原本定位通用计算的 CPU 芯片,也加入了为 AI 加速的行列。

今天,代号为「Sapphire Rapids」的第四代至强可扩展处理器也在中国迎来发布首秀,除了一系列微架构的革新和技术规格的升级外,新 CPU 对 AI 运算「更上层楼」的支持也格外引人关注,其背后的技术助力,也是英特尔在这代产品中增添的全新内置 AI 加速器 —— 英特尔高级矩阵扩展(AMX)技术自然也成为了焦点。

作为焦点,当然要拿出实力来证明自己的价值 —— 在发布会上,英特尔透露的第四代至强可扩展处理器的基础算力平均提升值为 53%,而在 AMX 的助推下,其在 PyTorch 上的 AI 实时推理速度,可提升至上一代产品(FP32)的 5.7-10 倍,训练性能提升最高也能提升到上一代产品的 10 倍…… 这意味着,这款新至强,把业界顶级 CPU 的性能门槛一下子提高了不少。

英特尔新CPU发布之后,AI计算的格局要变了

新一代英特尔 CPU 为 AI 任务处理找到了新方向。现在,英特尔可以通过新 CPU 和 GPU 实现对各类 AI 任务的加速。为实现这些提升,英特尔引入了一系列内置加速单元。

多种加速器加持,提升 AI 训练、推理及端到端性能

AI 的热度,从 AlphaGo 一鸣惊人后,一直就没有减退。最近一段时间,人们都在谈论 ChatGPT 等「大模型」带来的革命性体验。由预训练模型方法推动的 AI 技术正在向跨任务、跨模态的方向演进,已成为当下 AI 技术发展的重要趋势。

然而,大模型虽然带来了前所未有的 AI 能力,又对算力提出了无穷无尽的需求。芯片制造商和科技公司一直在寻找提升 AI 应用效率的方法。GPU 更多解决的,是训练效率,是探索 AI 算法边界的能力,而 CPU,似乎更适合在 AI 应用的规模化部署和实践上发挥重要作用。

自从四五年前开始在 CPU 中内置针对 AI 进行加速的专用运算单元或指令集后,英特尔就一直相信,如果想要在更为广泛的行业中真正推进 AI 应用的普及,那么就应该充分利用现阶段应用和部署最为广泛的 IT 基础设施和架构,也就是要更加充分地利用 CPU 的资源。毕竟使用 GPU 和其他专用加速器的成本以及知识和人才门槛都非常高。相比之下,CPU 内置 AI 加速能力,主攻 AI 推理加速,并搭配以更为简单易用、能够部署和优化难度的软件工具,会是一条更为行之有效的路径。

它是这么想,也是这么做的 —— 首先,从 2017 年第一代至强可扩展芯片开始,英特尔就开始利用英特尔高级矢量扩展 512 技术(AVX-512 指令集)的矢量运算能力对 AI 进行加速上的尝试,到 2018 年英特尔在第二代至强可扩展芯片导入深度学习加速(DL Boost)技术,更是让至强成为了首款集成 AI 加速有力的主流数据中心级 CPU,或者说:CPU 加速 AI 的代名词。

2020 年通过扩展出 bfloat16 加速功能,面向多路服务器的第三代至强可扩展处理器在推理加速能力之外,又增加了训练加速能力,已被证明可以帮助业界大量 AI 工作负载实现更优的性能和功耗比。

就在大家认为英特尔在 CPU 加速 AI 的技术创新和投入会止步于此的时候,第四代至强可扩展芯片,又带来了矩阵化的算力支持 ——AMX。

英特尔新CPU发布之后,AI计算的格局要变了

第四代英特尔至强可扩展处理器。

这种全新内置 AI 加速器的出现,进一步验证了「与其增加 CPU 内核数和时钟频率,加入和更新专用计算单元对提升 AI 工作负载性能更有效」这一思路。正如前文所述,第四代至强可扩展芯片不仅可借助 AMX 实现相当于上一代芯片(FP32)10 倍的 AI 性能提升,与前两代产品使用的深度学习加速技术相比,其理论性能(每秒操作量)最高也可以达到其 8 倍之多。

机器学习包含大量的矩阵计算,在主打通用计算的 CPU 上,此类任务会被转换为效率较低的向量计算,而在加入专用的矩阵计算单元后,至强 CPU 的 AI 能力有了巨大的提升。因此,AMX 可以被视为至强 CPU 上的「TensorCore」—— 从原理上看,CPU 上的 AI 加速器实现的目的和 GPU、移动端处理器上的类似。由于 AMX 单元对底层矩阵计算进行加速,理论上它对于所有基于深度学习的 AI 应用都能起到效果。

英特尔新CPU发布之后,AI计算的格局要变了

如果说 AMX 为至强 CPU 带来的是直观的推理和训练加速,那么第四代至强可扩展芯片内置的其他几种加速器,就是为 AI 端到端应用加速带来的惊喜。

这是因为在真正完整的 AI 应用流水线中,任务往往会从数据的处理和准备开始,在这一阶段,第四代至强可扩展芯片内置的数据流加速器(DSA),可让数据存储与传输性能提升到上一代产品的 2 倍,而专门针对数据库和数据分析加速的英特尔存内分析加速器(IAA),也可将相关应用的性能提升到上一代产品的三倍(RocksDB);数据保护与压缩加速技术(QAT),则能在内核用量减少多达 95% 的情况下将一级压缩吞吐量提升至原来的两倍。这些技术的使用,也有助于 AI 端到端应用性能的整体跃升。

英特尔新CPU发布之后,AI计算的格局要变了

此外,随着 AI 应用在更多行业,包括金融、医疗等数据敏感型行业的落地,人们对于数据安全合规的要求逐渐提高,联邦学习等技术逐渐获得应用。在这一方面,至强可扩展处理器集成的专攻数据安全强化的加速器 —— 软件防护扩展(SGX),也是大有用武之地,它的突出优势就是可以为处理中或运行中的敏感数据和应用代码提供与其他系统组件和软件隔离的安全飞地,实现更小的信任边界。

这种技术对于 AI 而言,最核心的价值就是可以让有多方数据交互、协作的 AI 训练过程变得更加安全,各方数据都可以在其拥有者的本地参与训练,用于训练的数据和模型会被安全飞地所保护,最终模型可以在这种保护下提升精度和效率,但为其演进做出了关键贡献的数据则会一直处于「可用而不可见 」的状态下,以确保其中的敏感和隐私信息的安全性。

在这么多内置加速器的支持下,可以说,从数据预处理,到训练,再到推理,最后到整个 AI 应用的安全保护层面,第四代至强可扩展处理器都实现了更全面的功能覆盖和重点增强。与此同时,英特尔还在进一步强化 AI 加速的开箱即用优势:通过与大量第三方进行合作,英特尔共同优化了 SAP HANA、Microsoft SQL Server、Oracle、VMware Cloud Foundation、Red Hat OpenShift 等主流应用,很多主流软件库和开源机器学习框架,以及大多数云服务也对这款英特尔架构上的新品做好了优化,开发者可以直接使用新硬件开发和部署 AI 算法。

从开发者的角度看,使用第四代至强可扩展处理器实现优化加速的门槛也确实很低:人们只需使用集成在 TensorFlow 和 PyTorch 中的库,无需任何额外工作即可激活至强芯片内置 AI 加速的能力。此外,只需更改几行代码,开发人员就可以无缝地加速单节点和多节点配置中的 Scikit-learn 应用。

全能服务器 CPU

除了有加速器傍身专攻特定应用负载外,第四代至强可扩展处理器在基础性能上也是可圈可点。

例如,它采用了与英特尔第 12、13 代酷睿同款的 Intel 7 制造工艺(改进版 10nm 制程)和 Golden Cove CPU 架构,同时首次引入 chiplet 小芯片封装方式,最多可搭载 60 个核心,改用新的 Socket E LGA4677 封装接口,集成了 112MB 三级缓存,功耗最高达到 350W。

新一代至强还带来了对八通道 DDR5-4800 和 PCIe 5.0 的支持,并包含 CXL 1.1 高速互连总线,可选集成最多 64GB HBM2e 内存。

上述这些针对 IO 和存储的新技术的引入,使得第四代至强可扩展处理器具备了能够打破带宽瓶颈的 I/O 能力,让使用者可以充分利用处理器的代际性能提升满足 AI 平台等业务对于通用算力的苛刻需求。

英特尔新CPU发布之后,AI计算的格局要变了

四代至强可扩展处理器平台特性。

综合这些基础芯片架构规模上的升级和革新,以及各种加速器的特定加成效果,第四代至强可扩展处理器的基础算力相比上一代产品可提升 53%,而其能效,或者说每瓦性能,相比上一代产品也提升了 2.9 倍,这意味着更高的效率,更低的功耗和更优的投资回报率。

英特尔表示,新一代 CPU 还可以催生出前所未有的应用,帮助 AI 算法直接利用非结构化数据进行实时分析。在金融、医疗、零售等行业中,人们可以利用机器学习作出更加精确的投资决策,降低术后并发症风险,更好地理解消费者的需求。

构建下一代异构 AI 算力

在不断寻求创新业务的过程中,人们对于算力的需求相比以往正变得更加迫切。而且这种算力也必须要兼顾到通用和专用的不同方向。因此英特尔架构也正在就此有针对性的演进,这在本次第四代至强可扩展处理器的发布会上就可见一斑 —— 对科学计算和 AI 加速有更苛刻要求的用户,也等来了英特尔数据中心 GPU 旗舰产品 ——MAX 系列的发布。

英特尔新CPU发布之后,AI计算的格局要变了

其实在过去几年里,英特尔已经陆续推出了一些异构产品,例如 2022 年英特尔旗下的 Habana Labs 正式发布了用于深度学习训练的 Gaudi2,随之被应用在 AWS 上。同年夏天主打视觉云应用的数据中心 GPU Flex 系列也在视频处理、云游戏和视觉 AI 推理应用中初露头脚,但很多「发烧级」用户最期待的还是数据中心 GPU Max 系列,今天,这款采用了突破性设计,采用多芯片集合的方式,混合 5 种工艺,晶体管数量超过千亿的 「怪兽」,终于来了!

GPU 产品线的完善,也使得英特尔成为业界唯一一家能提供横跨 CPU、GPU、ASIC、FPGA 四大类型芯片计算解决方案的供应商,可为智能数据中心提供基于任何场景、需求的产品组合。

强大的硬件之外,英特尔还利用 oneAPI 软件体系实现了对异构硬件的统一编程和管理,构建了能够灵活调配、无缝协作和低门槛的 AI 开发工具。通过 XPU 硬件、oneAPI 软件及 UCIe 开放标准的布局,英特尔已经打造出了软硬一体化的完整生态。

随着新一代芯片发布,我们或许将看到未来 AI 计算的形态发生重要转变。

*本文图片均来源于网络

本文来自投稿,不代表创造权威IP 赋能创业者——IP百创立场,如若转载,请注明出处:创造权威IP 赋能创业者——IP百创

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
上一篇 2023年1月13日
下一篇 2023年1月13日

相关推荐

  • 娱乐直播的配角时代:yy办盛典,秀场直播退烧不退场

    曾经一度占据互联网经济中心位置的“娱乐直播平台”已经逐渐“边缘化”,但明确的商业模式(打赏)以及基本盘不小的存量用户群,让娱乐直播的盈利能力仍不容小觑……

    2023年3月2日
  • 汉川市经开投资公司登记成立注册资本8亿

    天眼查工商信息显示,近日,汉川市经开投资有限公司成立,法定代表人为王典辉,注册资本8亿人民币,经营范围含企业总部管理、土地整治服务、工程管理服务、物业管理、园区管理服务、普通货物仓储服务、供应链管理服务、公共事业管理服务、水资源管理、房地产开发经营等。股东信息显示,该公司由汉川市汉江国有资本投资运营有限公司全资持股。 天眼查信息:https://www.ti…

    2025年10月24日
  • 拉卡拉等在上海成立创业投资基金# 出资额2.2亿

    天眼查App显示,近日,上海考拉灵犀创业投资基金合伙企业(有限合伙)成立,执行事务合伙人为北京考拉宏途企业管理中心(有限合伙),出资额2.2亿人民币,经营范围为创业投资。合伙人信息显示,该基金由拉卡拉支付股份有限公司、上海国投先导人工智能私募投资基金合伙企业(有限合伙)、北京考拉宏途企业管理中心(有限合伙)共同出资。 天眼查信息:https://www.ti…

  • 何秋亊演唱会主办方被执行4.7万

    #何秋亊演唱会主办方被执行# 天眼查天眼风险信息显示,3月3日,何秋亊演唱会主办方杭州西红柿控股有限公司新增一则被执行人信息,执行标的4.7万元,执行法院为杭州市余杭区人民法院。 杭州西红柿控股有限公司成立于2023年10月,法定代表人为王秀华,注册资本1000万人民币,经营范围包括互联网销售、文化娱乐经纪人服务、咨询策划服务等。股东信息显示,该公司由杭州金…

    2026年3月5日
  • 从D轮到IPO仅一个月:起底海清智元的AI资本神话

    当通用大模型赛道竞争白热化、同质化竞争态势加剧时,AI行业迎来了一位“非典型”玩家。

    2026年3月,聚焦多光谱AI赛道的海清智元,正式向港交所提交主板上市相关申请,这已经是公司二次递表去冲击港股IPO。有别于市面上主打通用AI的厂商,这家公司靠着“探知人眼看不见的光谱信息”的硬核技术,被贴上细分赛道头部企业标签,试图在港股讲述有区别的AI资本故事。

    不过,在刚刚上交的招股书中,我们看到的实则是一幅有张力的现实图景。一边是营收多年来持续疯涨、细分赛道市占率夺得第一的漂亮答卷,一边是现金流不断失血、存货快速增长、供应链两头受压的艰难现状。

    这不仅是一家初创企业的上市路书,更是硬科技公司在商业化落地前夜的典型缩影。

    战略突围:AI赛道的“田忌赛马”术

    在AI行业当中,选择一般情况下比努力更要紧。

    面对百度、阿里、腾讯等巨头大力投入的通用大模型、可见光AI赛道,海清智元没做正面的硬扛,而是精准进入了多光谱AI这一垂直细分领域里,趟出了一条“小众硬核”的差异化途径,这也是它资本故事当中最核心的闪光点。

    多光谱AI,主要是依托自己研发的多光谱感知硬件和AI算法,不只是收集可见光信息,还能准确辨认红外、紫外等肉眼没法发觉的物理光谱信号,进而在智慧城市的安防相关场景、数据中心的安全相关场景、工业检测等泛安全领域,做到更精准、更全面的感知探查。

    相较于普通可见光AI来说,它的应用场景更专一、技术壁垒更分化,也顺利避开了跟行业巨头的直接比拼,可说是AI赛道的田忌赛马做法。这份技术所呈现的差异,也让海清智元拿到细分赛道上的话语权。

    据弗若斯特沙利文所提供的数据显示,2024年公司在多光谱AI大模型服务领域全国市场份额处于第一,整体多光谱AI行业市占率也达到了3.5%,行业排名上位居第一,真真切切的细分赛道头部行家。

    (图源:弗若斯特沙利文)

    但在光环所覆盖之处,隐患在早前就埋下了。

    看似突出的龙头地位,实则不过是细分赛道的相对有利之处,而不是对行业有绝对的统治力。3.5%的整体市占率,清楚表明国内多光谱AI行业尚处在极度分散的起始时期,行业格局还没定型,头部所产生的效应极弱。

    哪怕海清智元眼下领跑,也没有打造出技术或市场的垄断性障碍,后续行业竞争程度加深、新玩家加入,都可能直接打破其现有的地位。

    营收狂飙与现金失血的博弈

    海清智元把纸面光鲜和现实窘迫展现得淋漓尽致,堪称硬科技公司业绩分裂的典型样本。

    先看亮眼的营收。公司在营收方面实现了爆发式增长,2023年营收仅1.17亿元,2024年直接飙升至5.23亿元,同比暴涨超346%,2025年进一步增至6.69亿元,三年营收复合增速堪称惊人。

    (图源:公司招股书)

    盈利层面也成功翻身,2023年净亏损1841.3万元,2024年扭亏为盈实现净利润4041.2万元,2025年依旧保持盈利状态,同时毛利率从2023年的12.22%一路攀升至22.35%,盈利效率稳步提升。

    可进入冰面之下,财务风险一下子暴露了。公司完全陷入了有收益、缺少现金的怪圈,盈利质量有很大下降,核心指标经营活动现金流一直呈现告急状态.2024年经营性现金净流量转负了,2025年净流出态势进一步发展,扩大到1.3亿元,账面盈利完全没有转化为实打实的现金流入。

    公司大部分营收都体现在应收账款上,贸易应收款项周转的天数不断拉长,体现出公司在下游客户跟前议价能力较差,为了保证营收的增速,不得不把回款的相关条件放宽,拿赊销促增收。

    这种形式上的富贵十分脆弱,尤其在当下信贷收紧、下游客户资金压力偏多的市场大环境下,应收账款的坏账风险大幅上升,一旦有大额坏账产生,公司盈利随时有从盈利走向亏损的风险。

    存货周转206天、供应商依赖近九成:海清智元的“失血”运营真相

    如果现金流问题是盈利质量的隐藏问题,那供应链跟存货产生的相关问题,更是直接抓住了海清智元运营的要害。

    当我们深扒海清智元的运营模式,会发现它完全是行业里的夹心层,上下游话语权双双缺失。

    先是下游端,客户集中度极高,前五大客户贡献了近五成营收,且客户稳定性偏弱,一旦核心大客户流失、缩减订单,公司营收将直接遭遇断崖式下滑。

    而上游端,对核心供应商依赖度更是惊人,报告期内对前五大供应商采购占比一度飙升至89.3%,核心零部件高度依赖少数供应商供货,上游供应链一旦出现断供、涨价、合作终止等问题,公司生产和交付都会直接停摆。

    更值得警惕的是存货异常积压。2025年第一季度,公司存货暴增554%,存货周转天数直接拉长至206天,远超行业合理水平。

    要知道,AI硬件行业技术迭代速度极快,产品更新换代周期短,长达200多天的存货周转,相当于把巨额资金压在仓库里,不仅占用大量流动资金,还面临着技术路线变更、市场需求下滑带来的存货跌价减值风险,一旦踩雷,将直接吞噬公司利润。

    结语

    上市前一年这么短时间,海清智元估值一下子涨了9倍,D轮融资之后,投后估值是35.5亿元,并且D轮融资到此次递表还不到一个月,资本催熟的迹象十分显著。

    但不可否认,多光谱AI是AI感知领域的优质细分赛道,行业规模正快速扩容,弗若斯特沙利文预计,2029年国内市场规模将飙升至588亿元,发展空间广阔,海清智元作为赛道先行者,已经抢占了先发优势。

    行业动态 2026年3月23日

发表回复

您的电子邮箱地址不会被公开。 必填项已用*标注

联系我们

邮件:939297903@qq.com

工作时间:周一至周五,9:30-18:30,节假日休息

关注微信