Arm Helium技术加持!Armv8.1-M架构产品AI推理能力大升级
7月18日,在WAIC 2026展会上,安谋科技CPU产品总监朱晓鸣发表了题为《STAR CPU,Helium 以及 Ethos 赋能万物AI》的演讲,分享了面向资源约束下嵌入式芯片AI赋能的设计思考与路径探索。
在端侧AI规模化落地、IoT向AIoT演进的关键节点,Arm架构凭借其在物联网生态中的基石地位,正成为嵌入式AI部署的核心支撑。面对功耗、时延与存储等多重资源约束,Arm推出了Cortex-M CPU系列、Helium矢量扩展技术及Ethos NPU专用加速器,已构建起完善的嵌入式AI技术体系。依托Arm成熟生态和技术,针对嵌入式AI场景,安谋科技打造了“星辰”CPU+Helium矢量扩展+Ethos NPU的AIoT原型平台,第一代平台选择STAR-MC2(即Cortex-M52)和Ethos-U55,代号“星辰300”,全面支持主流小模型,为传统MCU注入AI引擎,推动嵌入式设备迈向智能进化。

一、Arm Helium:为MCU注入矢量加速引擎
Arm Helium是内置于Arm Cortex-M CPU的矢量扩展技术,类似“软件可编程加速器”,可显著提升向量计算效率,其中在DSP场景中性能提升最高达5倍,在ML任务中更可达15倍。
当前,基于Armv8.1-M架构的Cortex-M52、M55、M85均已集成Helium。相比Armv7-M架构的Cortex-M4,在音频编解码场景下,Cortex-M52、M55、M85性能分别提升30%、50%、65%;ML推理方面,M55与M85较M7亦有大幅跃升。这些产品已广泛应用于小型超低功耗的嵌入式AI系统中,覆盖人脸识别、关键词识别、语音命令控制和静态图像处理等应用。

二、Arm Ethos:专用NPU突破性能与功耗瓶颈
从关键词唤醒到实时语音、物体检测乃至小语言模型推理,嵌入式AI负载持续升级,CPU通用计算在性能与功耗之间日益难以兼顾。Arm Ethos NPU系列应运而生,作为专用AI加速器与Cortex-M CPU协同工作,以极致的功耗和面积效率,为嵌入式设备提供高能效AI推理能力。
Arm NPU系列包括Ethos-U55、U65和U85。U55多部署于Cortex-M异构系统;U65将ML性能提升两倍,并将适用性扩展至Cortex-A系统。两款产品均原生支持CNN、RNN等常见ML网络,适用于协作机器人、机器视觉、视线控制和实时语音等场景。
U85作为高性能型号,原生支持Transformer,1GHz频率下算力达4TOPS,性能较前代提升4倍,能效提高20%,可胜任语言模型、语义分割和多实例等复杂任务。

三、安谋科技“星辰300”:从原型平台到落地实践
依托Arm在嵌入式领域的深厚积累,安谋科技面向AIoT推出“星辰”(STAR)CPU产品线,涵盖STAR-MC1、MC2、MC3三代产品。为顺应嵌入式AI演进,自STAR-MC2起全面集成Helium矢量扩展技术。
在此基础上,安谋科技进一步构建“星辰”CPU+Helium+Ethos NPU的AIoT原型平台,首代平台“星辰300”采用STAR-MC2与Ethos-U55组合,全面支持主流小模型,为传统MCU注入AI算力。
目前,“星辰300”已在FPGA平台跑通人脸探测、语音识别、关键字检测和图像超分等用例,可助力合作伙伴在智能手机、IoT及工业设备中部署高效AI计算能力。

纵观嵌入式AI发展,Arm凭借能效优势与生态积淀引领全局,安谋科技深度连接Arm生态,双方共同勾勒出一条清晰的路径:“星辰”CPU+Helium+Ethos NPU,让嵌入式设备在有限的功耗和算力下尽可能多的释放AI计算潜力,为终端节点注入感知、决策与执行能力,推动AI下沉至万物终端,加速嵌入式AI规模化落地。
本站部分内容来源于网络,转载目的在于传递更多信息,并不代表本网赞同其观点和对其真实性负责,本网站无法鉴别所上传图片或文字的知识版权,如果侵犯,请及时通知我们,本网站将在第一时间及时删除,不承担任何侵权责任。
