开云(中国大陆官方网站)Kaiyun科技股份有限公司 - 领先的GPU计算与AI算力解决方案

关闭菜单
027-83317177
当前位置: 首页 > 新闻资讯 > 行业新闻

AMD用AI优化AI!ROCmai发布本地能跑3000亿参数模型

2026-07-24 13:44:35 小编

  AMD在年度Advancing AI大会上连发多项软件和平台更新,从数据中心到本地开发再到机器人,整套AI软件生态正在全面铺开。

  AMD正式发布ROCm.ai软件栈,核心思路是用AI智能体来加速AI开发本身,整套软件栈分四层,分别对接编程智能体、工作负载优化、主流框架和底层工具,预计8月可用。

  其中最值得关注的是HyperLoom这套自动优化工作流,它能够自己分析模型性能瓶颈,定位需要调优的环节,然后自动执行优化并反复迭代。

  现场演示直接用Claude Code下达优化指令,系统自动完成性能剖析和调优,一次点击就把MiniMax M3推理性能拉升了38.3%。

  另一个演示则用Codex在Helios机架上跑起了1.6万亿参数的DeepSeek-V4 Pro,全程自动配置环境并启动模型。

  这种用AI优化AI的思路,实际效果已经体现在数据上,AMD的推理性能已经提升到ROCm 7初期的3.3倍,训练性能提升约2.4倍。

  DeepSeek-V4 Pro从4月获得首日支持到现在,仅靠软件优化,三个月就拿到了5.3倍性能提升。

  生态方面,ROCm已经支持Hugging Face上超过300万个模型,新开源模型发布当天就能跑,过去一年外部开发者贡献增长10倍以上,发布节奏也从每4到6个月一次压缩到大约每六周一次。

  AMD同时深化了和Hugging Face的合作,每台Ryzen AI Halo附赠一年Pro订阅,更重要的是,ROCm软件栈能横跨不同硬件平台,开发者可以先在本地跑模型、做微调,再无缝迁移到数据中心,不用换软件。

  目前AMD的个人AI生态已经覆盖笔记本、工作站、台式机和开发者平台等多种形态,主流AI PC配上足够内存就能跑240亿参数模型,本地模型性能也在快速提升,过去需要1000亿参数才能达到的效果,现在90亿参数就能做到。

  AMD这次还发布了一整套机器人开发工具,包括Ryzen AI Embedded X100嵌入式处理器、Kria AI系统模块和开发者平台,以及机器人合作伙伴网络。

  新发布的X100处理器主打低功耗始终在线架构,适合机器人这类对功耗敏感的场景。

  Kria AI系统模块(SOM)是AMD给机器人厂商准备的半成品,核心计算和接口已经做好,客户只需要设计自己的载板插上去就能用,大幅缩短产品上市时间。

  性能方面,和英伟达Jetson AGX Thor对比,Kria AI平台在实时控制性能上达到3.4倍,并发智能体数量2.3倍,CPU容量1.6倍。

  Kria AI机器人开发者平台计划今年第四季度出货,将搭载Ryzen AI Embedded X100系统模块和一块参考载板。

  载板自带FPGA做传感器数据整合,前面板专门给机器人接传感器用,支持时间敏感网络和摄像头等接口。

  AMD把载板的设计文件全部开源,客户可以根据自己的需求直接改,不用从零开始。

  其机器人合作伙伴网络也日益壮大,覆盖模型、中间件、传感器、应用与系统、物理仿真等领域,以及负责测试、验证和产业协作的相关组织。

联系专业的商务顾问,制定方案,专业设计,一对一咨询及其报价详情
服务热线服务热线 027-83317177
咨询kaiyun全站解决方案 马上咨询
免费获取技术咨询服务
姓名图标
电话图标
QQ图标

联系我们 contact us
027-83317177