具身智能产业关注的重点正从“能力涌现”进入“生产力兑现”阶段,拼的不只是单一模型能力。8 月 19 日下午,在北京举行的 2026 世界机器人大会上,百度集团副总裁袁佛玉表示,机器人从“会展示”到“能上岗,需要模型、数据与应用协同形成的系统能力。 百度集团副总裁 袁佛玉 模型从理解语言,走向理解和预测物理世界 机器人真正进入物理世界,仅理解语言并不够,还要理解物体关系、动作后果及环境变化。随着 VLA、世界模型和运动控制加速演进,计算工程系统也面临更高要求。 袁佛玉指出,依托百度百舸 AI 计算平台,百度智能云持续完善面向具身智能的 AI Infra,支持企业完成从数据处理、模型训练、仿真评测到真机推理部署的研发全流程,推动模型从研究原型走向工程系统;在部分合作中,单步推理延迟已进入百毫秒以内区间。 数据从训练材料,变成具身智能最核心的生产要素 具身数据采集成本高、标准不一,且与具体本体、任务和环境高度相关。 袁佛玉认为,未来的重要竞争要素,在于企业积累了多少有效任务小时、捕获了多少高价值失败样本,以及形成了多少能够回流训练的数据。相比重复完成同一动作,失败、纠正、人工接管和边界案例数…
清晨,一台具身智能机器人正在执行实验任务。 它需要完成数百次实验操作,包括试剂取放、试剂配置、自动分液、细胞毒性检测等流程,并实现多个实验设备之间的协同运行。整个过程中,实验室内无需人员操作,由机器人自主完成任务。 这个场景并非科幻小说,而正在国家级科研平台实验室真实发生。 科学智能(AI for Science)的产业革命 今年7月中旬,国家级科研平台实验室迎来了第一批人形机器人。这批名为Monte2的人形机器人,由源络科技与国家级科研实验室联合研发。它的外形并不科幻:两条机械臂、一个简洁的躯干,但执行的操作却比外表看起来精细得多——精准转移微量试剂、精准抓取仪器、自主调动工具,并完成核酸提取预处理、细胞毒性培养实验。与常见的六轴工业机器人不同,Monte2能够在实验台上完成长序列、灵活的实验操作,并复现人类实验员的操作逻辑。 像细胞毒性检测等实验涉及大量重复性操作、流程调试和实验检测,需要投入大量人力和物力。国家级科研实验室主任表示,通过引入人形机器人,科研人员无需持续值守实验现场,可以有效缓解人工操作带来的通量瓶颈和一致性问题。计划到2027年底,实验室将机器人数量扩展至约百台规…
当 AGI 的大脑决定向边缘迁徙,英伟达拿出了统治机器人进化的“终极剧本”。 编辑丨岑峰 2026 年,大模型行业正经历一场前所未有的“体感位移”。那个在纯数字世界几乎无往不利的 Scaling Law,在试图跨越到物理世界时,正遭遇物理规律、空间约束和长尾数据的残酷审判。 AI 行业最核心的矛盾正日趋明显:云端算力的指数级爆发,与机器人终端落地的步履蹒跚,构成了一种日益撕裂的鸿沟。 这种割裂感,在 7 月悉尼 RSS 2026的最后一天,被推向了最高潮。在 “Robot World Models(机器人世界模型)” Workshop 上,传统机器人学界对物理因果的“敬畏”,正与 AI 工业界对规模效应的“迷信”正面交锋。 就在这场范式撞击的火山口上,英伟达物理AI专家Max Li,为我们拆解了其新发布的重量级产品——Cosmos 3。 这不再仅仅是一个更逼真的视频生成器:它是全球首个在同一个 Transformer 架构下,彻底打通了文本、视觉、音频和动作全模态的世界基础模型。如果说过去两年的具身智能还处于“组装机”时代:开发者需要吃力地将视觉模型、语言模型和控制算法像乐高一样拼凑在…
从“像素导演”转向“具身大脑”:RSS 2026“机器人世界模型”专题现场见证,想象力正在终结具身智能的“数据暴政”。 编辑丨岑峰 2026 年 7 月的悉尼,RSS 会场内,一种复杂的情绪正在蔓延:一半是火焰,一半是海水。 火焰来自于大模型在云端的持续狂飙,海水则来自于具身智能在现实落地中的“物理阵痛”。 在此之前,全球 AI 行业笃信一套名为“暴力美学”的成功公式:巨大的参数量 + 几乎无穷的互联网数据 = 涌现的智能。 这一公式在处理文本、图像甚至是视频生成时无往不利。但当人们试图将这套逻辑直接“平移”到机器人身上,让 AGI 进入物理世界时,那道无形却坚硬的“物理之墙”出现了。 在云端,数据可以被无限次复制和合成;但在物理世界,每一次机械臂的抓取、每一次足式机器人的迈步,都受限于时间的线性和物理空间的约束。 当“暴力美学”撞上“物理硬墙”,那个在数字世界里几乎无所不能的 Scaling Law,在试图拧开一个生锈的螺丝钉或在杂乱的厨房里寻找一只空气炸锅时,表现出了令人沮丧的笨拙。 AI 行业最核心的矛盾已经转移:我们需要机器人像人类一样,拥有在行动前进行“想象”的能力。 在 R…
斯坦福团队提出:机器人不需要见过所有的失败,它只需要学会如何“脑补”另一种可能。 作者丨岑峰 在 AGI 的数字版图里,大语言模型仅靠“读遍互联网文本”就拼凑出了通往智能的通途。这种由 Scaling Law 带来的暴力美学,让整个具身智能行业在过去两年里陷入了一种盲目的“数据崇拜”:人们坚信,只要像训练大模型一样,喂下数以百万小时的视频,机械臂就能在物理世界中无所不能。 而在2026 年的悉尼 RSS 大会,AI科技评论注意到,越来越多的研究者开始讨论,物理世界的数据获取具有时间和空间的“不可逆性”——文本可以被瞬间复制亿万次,但机械臂抓取一次杯子,在物理时空中就必须实打实地消耗数秒。更致命的是长尾效应:摩擦、形变、流体……人类根本不可能通过穷举法,去收集齐机器人面临的所有场景。 来自斯坦福大学李飞飞实验室的 黄文龙(Wenlong Huang),在“Data-Centric Robotics”主题Workshop的演讲中给出了一个“降维打击”式的解法:抛弃对海量“演示数据”的死记硬背,转向“反事实推理”与“脑内搜索”。 作为近年具身智能领域的明星学者,黄文龙的名字此前因 VoxPo…
大模型能力持续演进,但 AI 的下一阶段竞争正在发生变化。模型能力之外,如何构建可靠的智能体、完善 AI 工程体系,并让 AI 在复杂业务环境中稳定运行,正在成为产业探索的新重点。 8 月 21 日-22 日,AICon 全球人工智能开发与应用大会"将在深圳举办。大会全日程现已100%上线,来自产业一线的技术专家将围绕 Agent 工程化、大模型基础设施、AI Native 研发、具身智能等前沿方向,分享 AI 时代的技术探索与工程实践,共同探讨 AI 从能力突破走向系统构建的新路径。 阿里云高级技术专家阮城锋已确认出席 “AI Agent 高价值商业场景实战"” 专题,并发表题为《让 Agent 真正驱动销售增长——FDE 模式下的业务流重构实战"》的主题分享。AI Agent 正在从能力探索进入商业化落地深水区。很多企业已经上线了客服助手、销售助手、知识助手、运营助手,但真正能带来业务增长、效率提升和风险降低的项目并不多。问题并不只是 Agent 是否足够智能,而是它是否真正进入了企业的高价值业务流,是否能帮助一线人员减少低价值动作、增强高价值判断,并最终转化为可衡量的业务结果。 …
如果只看今天端侧AI芯片的热门叙事,NPU几乎是绕不开的主角。 大模型从云端向手机、PC、机器人等终端下沉,芯片厂商不断刷新TOPS,围绕Transformer、增加专用加速能力。一颗新的端侧AI芯片,似乎应该尽可能把有限的晶体管留给NPU。 诚恒微却在首款旗舰SoC上做了一个不同的选择。 近期在无锡举行的CH37系列边端侧AI SoC产品发布会上,诚恒微正式发布CH3715。除了48 TOPS INT8的六核NPU,CH375还集成了10核CPU(含4大4小主核及2个R8实时控制核,R8核频率达800MHz)、自研渲染GPU(358 GFLOPS)、六核NPU(48 TOPS INT8/24 TOPS FP16)、四核GPGPU(1 TFLOPS FP32,兼容CUDA生态)、双核DSP及自研FFT硬件加速器。 为什么一颗端侧AI芯片,需要同时拥有NPU和GPGPU? 诚恒微CEO楚立斌 诚恒微CEO楚立斌对雷峰网表示,“CH3715的产品定义其实始于2022年。彼时ChatGPT尚未发布,具身智能也没有成为芯片行业追逐的热点,我们首先看到的是机器视觉、雷达、工业设备里一些长期没有被…
荣耀上一次让全行业意外,是 2020 年从华为独立出来。 但这一次,是一部手机。 几天前,荣耀 CEO 李健在广州正式发布 Robot Phone,9.59 毫米厚的机身里,塞着一个四自由度的钛合金机械云台,能够实现跟随音乐律动、拟人化交互、自动追焦等功能,产品定价 9999 元起。据李健在发布会上透露,算上前期新品预约,荣耀 RobotPhone 预定量已超 40 万台。 对行业而言,Robot Phone 是一个全新“物种”,在手机行业仍在追寻系统全面 AI 化的时期,荣耀凭借着在具身智能领域的技术积累,成功将两个看似相隔甚远的行业“捏”到了一起。 荣耀这一落子也恰逢其时。回过头看,2023 年是各家对模型大脑的比拼,而到了 2025 年,故事早已经向着“这具大脑能住进什么样的身体”发展,在这一概念热度空前的当下,荣耀也收获了一大波流量。 如今复杂的市场局面下,摆在荣耀面前的 Robot Phone 既是可选项,但也是必选项。 在一众友商中,小米汽车业务打开了新的增长曲线;CyberOne 人形机器人展示了小米在具身智能领域的布局。vivo 成立机器人 LAB 独立中心,专注消费级…
The robot is part of the companies' expanded partnership to shift physical AI from concepts to real-world deployments.

作者|Li Yuan 编辑|张鹏 8 月 10 日,宇树科技完成科创板申购,发行价 150.80 元,发行市值约 610 亿元,发行市盈率 219 倍,是通用设备行业平均值的近六倍。多家机构给出的挂牌后估值直接标到千亿以上,敲钟的日子很可能就落在这个月下旬,几乎与世界机器人大会撞在一起。 钱多,预期更高。钱多,预期更高。对标电动车,意味着一个万亿级的制造业;对标 AI,则意味着根本没有天花板——毕竟具身智能被寄予的,是让 AI 真正落进物理世界。 热的是估值,冷的是订单。可作对照的是另一组数字。2025 年宇树人形机器人出货 5500 多台,全球第一;工信部预计 2026 年全年整机产量有望突破 10 万台,比去年跳升五倍。增速极快,但总产值仍远撑不起千亿估值。 而行业真实的状态是,数据、本体、算法,没有一件可以叫收敛。但它跑得足够快,快到收敛那一天已经隐约能看见。 8 月 19 日至 23 日,2026 世界机器人大会在北京举行,300 多家企业、2000 多件展品。我们会去现场,和大家一起看看到时候今天真实的机器人产业到底是什么样。 先说一个可能不讨喜的预判:今年的 WRC,大概率…
作者|Li Yuan 编辑|郑玄 会算命的非遗挂件?专挑膝盖下手的外骨骼?会跳的机器人? 8 月 7 日,地瓜机器人办的这场闭门路演「地心引力 DemoDay 2026」,十个项目轮番上台,画风一个比一个野。 有做具身智能的,也有做智能硬件的,大部分都还初具雏形:一些项目,半年前才刚正式启动。 地瓜选择本场 Demoday 选手的调性,与其他不太一样。CEO 王丛开场就说:他不太在乎地瓜自己出货量多大、市场占有率多高,他更想看到的画面是,被他们孵化出来的那些五花八门的东西,能被随便拿一个回家,给爸妈玩,给孩子玩,路边看到都是。 地瓜过去一年一直在用真金白银和工程资源接住这批人——如果你也对押注早期、押注还没长成形的怪点子感兴趣,这十个项目值得一个个看看。 01 早期,但已经能跑起来的产品 在路演中获得亚军巡领科技做的是一台能实时看懂你挥杆动作、指出问题出在哪、再给一套改进方案的 AI 高尔夫教练设备。 他们的产品 BirdieSense 用两套视觉系统,一套追踪球,一套理解人的身体和挥杆,把过去只有 TrackMan 这类接近两万美元的专业设备才有的测量能力,压到了消费级价格。 硬件只…
2026 世界机器人大会展位图揭晓:8 月 19 日开幕,宇树科技、优必选等参展 8 月 16 日消息,2026 世界机器人大会将于 8 月 19 日至 23 日在北京经济技术开发区北人亦创国际会展中心举行。近日,2026 世界机器人大会展位图全揭晓。 作为大会展览的重要新增空间,智创馆面积达 2 万平方米,拥有更加开阔、通透的展示环境,将进一步提升企业参展和观众观展体验。 宇树科技、星海图、优必选、银河通用、自变量、明略科技、维他动力、智身科技、云深处、傅利叶、越疆、仙工、中科慧灵等代表性企业,将带来机器人整机、具身智能及人形机器人的最新成果。 北京、上海、浙江、湖北、广东、四川、吉林等地的人形机器人创新中心将齐聚智创馆,集中展示各地的创新成果。央企展区也将在这里亮相,集中展示中央企业在机器人领域的整体布局和应用成果。京东将整合物流、零售、工业、家政等应用场景,打造【未来人机共生新范式】超级展区。 智造馆将汇聚京城机电、珞石、中信重工、海尔集团、非夕、睿尔曼、云迹、擎朗、普渡、申昊科技、本末科技、国兴智能、美丽魔方机器人、源络科技等企业。绿的谐波、卧龙电驱、同川、新剑、五洲新春、鸣志…
在具身智能的演进中,世界模型被寄予厚望:它不仅要生成未来画面,更要帮助机器人理解世界如何连续变化。然而,当前主流的视频生成与部分机器人世界模型,它们的底层架构大多仍受制于一个固有的思维定式:离散的下一步预测(Discrete Next-step Prediction)。 简单来说,这种模式将连续的物理世界切分成了一帧帧静态的画面。AI 预测未来时,必须像翻连环画一样,根据当前帧去推演下一帧。这种方式在短时间的视觉生成上大放异彩,但面对长视距的物理任务时,却暴露出明显缺陷:由于误差会逐帧累积,时间一长,AI 就容易偏离原本的物理规律,产生不合逻辑的幻觉。 近日,清华大学智能产业研究院(AIR)与加州大学伯克利分校(BAIR)团队合作提出了一种全新的预测范式 ODEWorld,其建立在连续的“物理时间流”(Physical-Time Flow, PT-Flow)之上。与传统方法直接预测下一帧是什么不同,ODEWorld 试图学习的是:世界究竟怎样从当前状态连续地变化到未来状态。 图 | 连续世界模型概念(来源:受访者提供) 实验中,当研究人员把模型预测出的连续中间状态用于指导机器人后,四项…
A survey of over 700 professionals examines how visual and physical AI teams build systems, why models fail, and where data work drives production. Download this free whitepaper now!

In July, NVIDIA joined more than 200 companies and organizations in signing “Open Weights and American AI Leadership,” an open letter arguing that AI leadership will be measured not by any single frontier model but by whether an open ecosystem reaches every sector.

Forget YouTube videos — frontier physical AI models need multiple camera angles, dense annotation, and, soon, brain wave readings.
Developers building 3D, design, simulation, robotics, and industrial digital twin applications need ways to bring physical AI capabilities into the tools and... Developers building 3D, design, simulation, robotics, and industrial digital twin applications need ways to bring physical AI capabilities into the tools and services they already use. Many of these workflows already depend on OpenUSD scenes, simulation-ready (SimReady) assets, Blender-based workflows, CAD pipelines, or domain-specific a…
OpenUSD is an open, extensible framework that provides a common scene description language for physical AI. It enables teams to bring CAD data, simulation... OpenUSD is an open, extensible framework that provides a common scene description language for physical AI. It enables teams to bring CAD data, simulation assets, and real-world telemetry into a shared, physically accurate view of the world. Until now, building a USD implementation has typically required adapting a large existing codebase— …
中国具身智能公司 X Square Robot 提出通用机器人的整合技术栈:交互数据、预测物理变化的世界模型与统一感知规划的行动模型,并以 QUANXTA Zero 采集系统把轨迹放到真机回放来把控数据质量。AI 中文摘要
General Intuition is betting millions of hours of video game data can train the foundation models for physical AI, making it easier to build smarter robots with minimal real-world data.
Congratulations to the Berkeley Artificial Intelligence Research (BAIR) Lab class of 2026! This year, BAIR celebrates another remarkable group of Ph.D. graduates whose curiosity, creativity, and perseverance have pushed the frontiers of artificial intelligence and machine learning. Their work spans the breadth of modern AI — robotics and embodied intelligence, large language models and reasoning, computer vision, generative modeling, AI safety, human-AI interaction, AI for science and healthcare…
An increasingly common design pattern for autonomous vehicles (AVs), robotics, and spatial AI systems is bird's-eye-view (BEV) perception. BEV models project... An increasingly common design pattern for autonomous vehicles (AVs), robotics, and spatial AI systems is bird’s-eye-view (BEV) perception. BEV models project multicamera image features into a shared top-down grid, providing downstream perception and planning modules with a common spatial layout for reasoning about lanes, vehicles, pedest…
Physical AI—robots working autonomously alongside people in factories, warehouses, hospitals, and homes—is arriving faster than most expected. Traditional... Physical AI—robots working autonomously alongside people in factories, warehouses, hospitals, and homes—is arriving faster than most expected. Traditional safety which was built for structured environments can not work anymore as the spaces become more unstructured and robots move out of cages. AI-driven safety is the key. Marking a major m…
Claire chatted to Andrew Philippides from the University of Sussex about what we can learn from ants and bees to improve robot navigation. Andrew Philippides is a Professor of Biorobotics at the University of Sussex, where he co-directs the Centre for Computational Neuroscience and Robotics and the be.AI Leverhulme Doctoral centre for Biomimetic Embodied AI. […]
Gemini Robotics ER 1.6: Enhancing spatial reasoning and multi-view understanding for autonomous robotics.
Claire chatted to Vikas Enti from Reframe Systems about using robotics and automation to build climate-resilient, high-performance homes. Vikas Enti is the co-founder and CEO of Reframe Systems, a physical AI company rethinking how homes are built through automation and localized fabrication. He previously spent more than a decade at Amazon Robotics, where he helped […]
Claire chatted to Jamie Palmer from Icarus Robotics about building a robotic labour force to perform routine and risky tasks in orbit. Jamie Palmer is co-founder and CTO of Icarus Robotics. He earned a Master’s in Robotics from Columbia University on a full scholarship, researching intelligent, dexterous manipulation in the ROAM lab. Jamie developed and […]