2026世界人工智能大会(WAIC 2026)上,爱芯元智首度揭秘了“元曦”系列大算力AI推理产品。随着大模型应用逐步进入企业业务场景,Token成本、数据安全、响应效率和持续运行能力,正在成为企业部署AI时需要考虑的实际问题。

一、企业部署AI,需要综合考虑哪些成本?
企业使用大模型时,需要综合考虑云端Token调用、网络传输、本地设备、运维投入和后续扩容等成本。
当调用量持续增加时,云端推理费用会随实际使用规模变化。部分对数据安全、响应效率和持续运行有较高要求的业务,也会开始评估本地部署方式。
因此,企业关注的不只是模型能力,还包括推理任务应该部署在哪里,以及云端与本地计算如何根据业务需求进行配置。
二、什么是“元曦”系列大算力AI推理产品?
“元曦”是爱芯元智面向高并发、高负载推理需求打造的大算力AI推理产品系列。其中,A系列AI推理卡搭载超1000TOPS推理算力,并配备超大显存和超高显存带宽。
“元曦”系列基于爱芯元智自研的“爱芯通元”混合精度NPU架构。超大显存可用于承载模型权重与数据,超高显存带宽则可提升长文本推理、高清图像解析等高Token消耗任务的数据调度与处理效率。
“元曦”系列与M.2算力卡、标准化核心模组等产品共同形成分层AI计算产品组合,承接不同算力等级和部署规模的业务需求。

三、本地推理能带来哪些价值?
将部分适合的推理任务部署在本地,可以从成本、响应效率和数据处理方式等方面提升企业对AI运行的可控性。
成本方面,本地部署可减少部分持续云端调用需求。企业可结合实际调用量、硬件投入和运维成本,选择相应的部署方式。
效率方面,推理任务在本地完成,可减少部分网络传输环节,提升业务响应的稳定性,并为持续运行的模型任务提供计算支持。
数据方面,相关数据可更多留在企业内部处理,减少数据传输需求,满足部分业务对数据本地处理的要求。
本地推理并非完全替代云端,而是根据模型能力、业务负载和数据要求,与云端算力协同使用。

四、“元曦”系列主要面向哪些应用场景?
从产品定位来看,“元曦”系列主要面向机房集群、企业私有化知识库等高并发、高负载、本地化部署场景。
在企业知识库和私有化部署场景中,“元曦”系列可为企业内部文档、业务数据和知识库的检索、问答及推理任务提供本地计算支持。
在机房集群和持续推理场景中,其超大显存和超高显存带宽可支持中大型模型、长文本推理、高清图像解析等高负载任务。企业可根据模型体量、并发需求、数据安全要求和部署规模,选择相应的推理卡或服务器产品。
五、爱芯元智成立全资子公司“爱芯计算”
7月24日,爱芯元智正式宣布成立全资子公司“爱芯计算”。爱芯计算将全面承接并深化母公司自研“爱芯通元”混合精度NPU的深厚技术积累,凭借超高的计算效率与极低的物理功耗,在端侧及边缘侧推理上构建核心技术代差。其前瞻性的底层算子指令化架构设计,确保了系统具备极高的易用性与完备的算子支持度,实现主流模型在边端侧“极速转换与一键跑通”。爱芯计算将核心聚焦提供领先的AI推理解决方案,通过算力卡等标准化参考方案的完整交付,赋能具身智能、智慧办公、智慧零售、智慧教育、智慧工业等多元物理AI应用场景,助力客户快速实现商业闭环。
爱芯计算的成立,标志着爱芯元智在AI算力领域的战略布局全面升级,旨在进一步聚焦AI计算核心能力,加速AI推理技术的创新与应用,为蓬勃发展的AI产业提供更专业、高效的算力解决方案。
编辑:faburen4