后摩智能M50芯片开发板亮相WAIC,AI推理性能号称比肩英伟达

后摩智能在WAIC 2025上展示了基于M50芯片的开发板,主打存算一体架构,AI推理能效号称可达英伟达Orin的3倍。目前该产品处于announced状态,尚未公布量产时间与价格。


图片来自 irishtimes.com 的相关公开报道,展示产品、原型、使用场景或事件背景;具体信息以原始来源为准。 摄影/版权标识:irishtimes.com。 来源:irishtimes.com


在刚刚结束的WAIC 2025上,一家中国AI芯片公司后摩智能悄悄亮出了一块开发板,上面搭载的M50芯片号称能用存算一体架构把AI推理能效拉到英伟达Orin的3倍。现场演示中,这块板子跑起了实时目标检测和语义分割,功耗却只有十几瓦——要知道,同等算力的传统GPU方案往往要吃掉几十甚至上百瓦。不过,这还只是一块开发板,距离消费者能买到的产品还有距离。

目前能确认到哪一步
announced:后摩智能在WAIC 2025上展示了M50芯片及开发板,属于厂商公开宣布但尚未量产的状态。所有性能数据均来自厂商宣称,未经第三方独立验证。


存算一体:把计算塞进内存里
传统AI芯片跑模型时,数据要在计算单元和内存之间来回搬运,这就像工人每次拧螺丝都要跑回仓库取工具——大部分时间和能量都耗在了路上。后摩智能的M50采用存算一体架构,把计算单元直接集成到存储单元中,让数据在“原地”完成处理。据厂商称,这种设计能将AI推理能效提升数倍,在运行ResNet-50等经典模型时,每瓦性能可达英伟达Orin的3倍。

不过,存算一体并非新鲜概念,此前多家初创公司都曾尝试,但量产落地者寥寥。后摩智能声称M50已流片成功,并在WAIC现场用开发板跑通了YOLOv5和UNet等模型。但现场演示多为预设场景,实际部署中的通用性和易用性仍有待观察。


图片来自 irishtimes.com 的相关公开报道,展示产品、原型、使用场景或事件背景;具体信息以原始来源为准。 摄影/版权标识:irishtimes.com。 来源:irishtimes.com


开发板亮相:瞄准边缘AI,但离产品还有距离
M50开发板大小接近一张信用卡,提供了PCIe、USB和以太网接口,可外接摄像头和传感器。后摩智能将其定位为边缘计算和自动驾驶的推理加速方案,现场演示中,开发板实时处理了1080p视频流,对行人、车辆进行检测,延迟控制在30毫秒以内。功耗方面,厂商称典型场景下整板功耗不到15W,远低于同类GPU方案。

但需要明确的是,这只是一块开发板,并非最终产品。后摩智能尚未公布M50芯片的量产时间表、批量价格以及完整的软件工具链支持情况。对于开发者而言,从拿到开发板到真正部署到产品中,还有很长的路要走。


图片来自 photographytalk.com 的相关公开报道,展示产品、原型、使用场景或事件背景;具体信息以原始来源为准。 摄影/版权标识:photographytalk.com。 来源:photographytalk.com



图片来自 photographytalk.com 的相关公开报道,展示产品、原型、使用场景或事件背景;具体信息以原始来源为准。 摄影/版权标识:photographytalk.com。 来源:photographytalk.com


国产AI芯片的突围战:能效是王牌,生态是短板
在英伟达几乎垄断AI训练市场的当下,国产芯片公司纷纷从推理侧寻找突破口。后摩智能的M50主打能效比,试图在自动驾驶、工业视觉等边缘场景中分一杯羹。据厂商数据,M50的INT8算力可达32TOPS,能效比超过2TOPS/W,这一数字确实亮眼。但实际应用中,能效比往往受制于模型适配和散热条件,实验室数据与真实场景存在差距。

更大的挑战在于生态。英伟达的CUDA生态经过多年积累,开发者工具链成熟,而存算一体芯片通常需要专用编译器来映射模型。后摩智能表示已支持PyTorch和TensorFlow,但兼容性和性能优化仍需时间验证。对于普通用户来说,M50开发板更像一个信号:国产AI芯片正在从“能用”走向“好用”,但距离大规模普及还有一段路。

资料线索
dublinlive.ie
irishmirror.ie
irishtimes.com
dublinlive.ie
canon.ca
amazon.com
photographytalk.com
m50.lv

本文是基于公开页面整理的 AI 硬件情报,不是本站实测或购买建议。图片发布副本增加 waoo.ai 水印,原摄影者和来源标识保留。
0
一起维护这篇内容

发现链接失效、信息过时或内容有误,可以提交更新建议。

我要更新

交流讨论

最新评论

返回顶部