前两年,我在河南、河北、东莞、深圳等地,认识过一批「AI 玩具公司」。 它们做的事情大体相似:定制一个手办,再给它加上语音对话;或者把语音模组塞进毛绒玩具,让一个普通玩偶可以和人聊天。一些公司甚至借着 AI 的新鲜感迅速出海。 2024 年前后,这件事情本身还有一定的技术门槛。要让一个玩具真正开口,需要把主控、麦克风、联网等硬件,与 ASR、LLM、TTS 等软件服务串起来。对于传统玩具厂商和 IP 方来说,这已经超出了原本熟悉的能力范围。 但这两年,AI 硬件的开发门槛下降得越来越快。 3D 打印、PCB 打样和成熟开发板越来越容易获得,开源社区也已经提供了大量现成方案,从语音对话到舵机、电机控制,都可以找到较为成熟的项目。 最近,我们拿到了这样一块近乎「傻瓜式」的 AI 模组。不用写代码,在开发平台选好模型、音色和角色,几分钟就能让它开口说话。再塞进一个毛绒玩具,一款最基础的 AI 玩具就有了。 做出这块模组的是一家 2025 年成立的澜存科技。 澜存目前有两个核心产品:澜卡 LC-1.7 系列标准 AI 模组,以及配套的澜存智能平台。前者集成语音、联网和多种硬件接口,可以继续外接…

Zhipu AI's GLM-5.3-Flash runs entirely on domestic AI chips and is gaining traction across benchmark and usage rankings.

作者|包永刚 编辑|林觉民 英伟达GTC,聚光灯总属于最新一代GPU,但中国芯片投资人李华今年却盯上了CPU。 黄仁勋在台上表示,进入推理时代,并不是所有任务都需要塞进GPU机柜。随后,他展示了独立的CPU机柜、存储机柜和LPU机柜。过去几年站在GPU身后的CPU,被单独摆到了聚光灯下。 看到这一幕,李华重新联系了一家自己此前看过、最终没有投资的Arm CPU创业公司。几个月前,他还认为CPU市场格局稳定、初创公司机会有限;这一次,他开始询问对方的融资情况和产品进度。 李华不是唯一回头研究CPU的投资人。 “我们从2025年底就开始系统性研究CPU的投资机会。”商汤国香资本合伙人李扬对雷峰网表示,“2026年,以Agent为代表的推理需求兴起,让我们投资CPU的逻辑从两层变成了三层。” Agent兴起后,CPU的需求、价格和资本关注度同时抬升。多位业内专家将未来五年视为国内CPU公司的关键窗口期。 但市场升温并不意味着所有公司都拿到了入场券。被Agent点燃的CPU市场,正在走向一场横跨技术路线、新旧玩家和应用场景的五年混战。这场混战最大的变量是什么?欢迎添加作者微信BENSONEIT…

“物理 AI 没有纯做 OpenAI 的机会,只有做苹果的机会。”
只需手机“碰一下”,就能租借机器人,甚至让它跳舞表演? 8月28日,全国首家“碰一下”机器人租赁体验店在上海徐汇区新六百YOUNG商场焕新开业。该店由宇树科技核心生态伙伴具深科技旗下品牌“机时租”接入支付宝“碰一下”能力打造,实现线下机器人“碰一下”快捷租赁,并支持“碰一下”唤醒AI智能体操控机器人动作。活动当日,普通市民可实现零门槛沉浸式感受“一碰即控”的机器人互动乐趣。 开业当天,“机时租”联合支付宝发起 “碰一下”机器人痛楼答题闯关活动。顾客在商场内找到部署好的多台宇树机器人,用手机“碰一下”参与答题挑战,每通过一关就有机会获得操控机器狗的体验奖励,三关全过还能解锁隐藏福利,到店观看机器人群舞表演。 市民刘先生体验过后兴奋表示:“在机时租具身智能体验店的体验感拉满了!碰一下支付后就能指挥它做动作,感觉自己跟机器人的距离拉近了!”另据店内工作人员介绍,消费者体验结束,还能用支付宝“碰一下”直接完成支付,把心仪的机器人租回家。 据悉,支付宝“碰一下”已于今年7月完成AI升级,目前覆盖4亿用户、2300余家生态服务商、超3000万线下AI触点,构建起了全球首个大规模线下AI经营网络。 …

China’s top makers of multilayer ceramic capacitors (MLCCs) – ubiquitous components known as the “rice of the electronics industry” – saw their shares rise on Friday after reporting ballooning first-half sales and profits amid soaring demand linked to AI. Shenzhen-listed shares of Chaozhou Three-Circle Company (CCTC) and Guangdong Fenghua Advanced Technology, two of the country’s largest MLCC makers, gained nearly 1 per cent and 3 per cent, respectively, in morning trading. CCTC’s Hong...

Token 成本成为大模型硬件竞争的新坐标。 作者丨郑佳美 编辑丨岑 峰 今天,OpenAI 的自研推理芯片 Jalapeño,终于从规格表走到了跑分台。 这次公开的数据很接地气:Token 吞吐、生成延迟、单位功耗下能跑多少推理。因为大模型上线以后,芯片面对的早就不只是一次训练任务。ChatGPT 要一直回消息,Reasoning 模型要持续生成长链路内容,Agent 还会一轮接一轮调用模型。算力再高,Token 吐得慢、延迟压不下来、功耗又高,数据中心照样难受。 成绩一出来,Reddit 很快就把 Jalapeño 和 NVIDIA Rubin 摆到了一起。有人认为它已经进入 Rubin 的效率区间,也有人认为测试条件、软件优化和整个平台形态没有对齐,现在还没法直接分高下。争论暂时停在这里,没有统一答案。 更巧的是,Jalapeño 并不是孤例。NVIDIA 正在把 Groq 3 LPU 拉进推理系统,专门处理 Token 生成;Google 也把 TPU 8 拆成偏训练和偏推理的两条路线。几家公司几乎在同一时间开始重新拆芯片的工作,背后那套硬件逻辑难道真的已经变了吗? 01 Ja…

对人来说,推门近乎是一种下意识动作。对移动操作机器人来说,这是一道把感知、移动、操作和控制绑在一起的综合题。 机器人需要找到并靠近把手,完成接触与旋转,在门体移动时协调底盘、机械臂和夹爪,还要避开门框、连续穿过狭窄门口。任何一步出现误差,都可能让整段任务中断。 近日,由纽娲机器人、上海交通大学和山东大学研究人员共同完成的 Video2DoorTraversal 预印本公开发布。上海交通大学博士生唐心诚为第一作者, 纽娲机器人创始人、上海交通大学特聘教授杨睿刚为论文通讯作者。 论文提出了一套面向轮足移动操作机器人的单视频 Real-to-Sim-to-Real 框架:用一段普通 RGB 视频重建真实门的数字孪生 DoorTwin,在仿真中生成并筛选可执行轨迹,再训练机器人完成从接近、开门到穿越的连续任务。 需要说明的是,五扇门的主实验并非用一段视频训练一个策略后直接覆盖全部对象。研究针对每扇目标门分别采集一段 RGB 视频,在论文指定的轮足移动操作平台上每扇各测试 35 次,共完成 175 次测试,其中成功 169 次,平均成功率为 96.57%。在三扇结构相似、训练阶段未见过的门上,策…

当 VLA 模型理解语言、感知环境并直接生成机器人动作,一个更基础的问题开始浮现:机器人如何理解一个持续变化的物理世界?物体从哪里移动而来、杯子此前遮住了什么、机械臂正在接近还是远离目标——真正决定下一步动作的信息,往往不只存在于当前一帧,而存在于连续的时间之中。 近日,大晓机器人联合香港大学发布全新的连续物理智能研究成果 StreamPI(Streaming Multimodal Temporal Modeling for Vision-Language-Action Models),直指 VLA 长期存在的“单帧智能”瓶颈,为其补上关键的“时间维度”。不同于传统 VLA 主要依据当前观测独立决策,StreamPI 为模型建立持续的多模态时序上下文,使机器人能够记住过去、理解状态变化、判断任务进程,并利用跨帧信息增强精细空间感知与动作决策。它推动 VLA 从“识别当前状态”,进一步走向“理解一个正在发生的物理过程”。 更重要的是,StreamPI 并未依赖额外参数堆叠换取时序能力,而是基于现有 VLA 骨干,通过指令持续锚定、历史信息流式缓存与随机时间间隔训练,实现从单帧决策到连续时…

全球主流 AI API 集体翻车,隐藏推理被成功还原,谁在偷听 AI 的「心声」? 作者丨郑佳美 编辑丨岑 峰 昨天,X 用户 @kotekjedi_ml 公布了一组很反常的实验:Claude、GPT 和 Gemini API 里原本不向用户展示的隐藏 reasoning,被研究人员重新恢复成了可读文本。 按正常设计,这些 reasoning 本来应该是看不到的。模型完成内部推理后,API 会把这部分内容加密成一段 opaque block 返回给客户端。用户拿得到这段数据,但无法直接读取,也不能随意修改,等到下一轮调用时,再把它原样交回服务器,模型就能接着之前的状态继续推理。 问题出在这些 encrypted reasoning 并没有始终和原来的模型、会话严格绑定。 一段由强模型生成的隐藏推理,在一些情况下可以被同一家厂商的另一个模型继续读取。于是,研究人员不再尝试让强模型自己交出 Chain-of-Thought,而是把它留下的 encrypted reasoning 交给一个更容易被绕过的兼容模型,再让后者把已经加载的内容转录出来。 整个过程没有拿到服务端密钥,也没有破解 en…

128K 长上下文与 3.1 倍推理加速背后,Meta 正在重构本地 Agent 的底层逻辑。 作者丨郑佳美 编辑丨岑 峰 昨天,Meta 发布了 Muse Glimmer。这是一款约 30B 参数的多模态 Agent 模型,支持 128K 级上下文,可以调用工具、执行代码,也能处理图片和屏幕信息。 这个模型采用 Apache 2.0 许可证开放,同时还有两套 4 bit 量化版本、独立视觉编码器和 DFlash 推理加速组件,并提供 llama.cpp、MLX、ExecuTorch 等本地部署方式。 虽然 30B 的参数规模和 128K 的上下文在今天看来并不稀奇,但问题在于,Meta 想让它干的不是普通聊天,而在于建立一套完整的本地 Agent 运行范式。 Muse Glimmer 面向的长期运行的本地 Agent,会面临着苛刻的工程约束:它必须在有限的 24GB 显存里,一边处理不断产生的屏幕截图,一边维持长达几十步的任务逻辑。一次任务跑上几十步以后,前面的工具结果、代码日志、页面状态和推理过程会不断留在上下文里。 这时候,很多在聊天场景里不明显的问题会迅速放大。128K 上下文…

MoK:把 token 调度、跨 GPU 通信和专家计算塞进同一个 GPU 内核。 作者丨郑佳美 编辑丨岑 峰 7 月 21 日,NVIDIA 公布了 GB300 NVL72 训练 DeepSeek-V3 的最新成绩:256 张 GPU 上,单卡性能达到 1,648 TFLOPS。 不到两周后,Cursor 开源了 Mixture-of-Kittens,简称 MoK。它没有继续折腾更快的矩阵乘法,而是直接重写了一层 MoE 的执行方式,把 token 调度、跨 GPU 通信和专家计算塞进同一个 GPU 内核。 这件事有点反直觉。因为 GB300 NVL72 已经把 72 张 GPU 放进同一个 NVLink Domain,整机架 NVLink 总带宽达到 130 TB/s。按这个规格看,GPU 之间传数据应该已经足够快。 可在大规模 MoE 训练里,通信依然会拖住专家计算。 问题出在 MoE 的数据流。Router 每一步都会重新决定 token 去哪个专家,而专家分散在不同 GPU 上。token 要先跨卡送过去,算完再传回来;发送之前还要整理位置,到达之后还要等待数据完整。随着 M…

2016 年博士毕业时,丁文伯手握麻省理工学院和佐治亚理工学院的博士后机会。前者延续了他此前的通信研究,后者则指向跨度更大的柔性电子与电子皮肤。 此前,他已经在清华电子系做了多年通信、雷达与信号处理。选择麻省理工的方向,显然更加顺理成章。 但也是在那个阶段,他观察到,通信研究的重心正在越来越多地从学术界转向工业界;反观柔性电子领域,仍有许多基础问题亟待解决。反复权衡后,他最终选择了佐治亚理工学院,跟随王中林院士从零开始。 “很多人当时不太理解,为什么放弃排名更靠前的学校。”如今回头看,丁文伯说,这次选择也让他逐渐形成了一套自己的研究取向:先判断一个问题是否值得做,再去寻找解决它所需要的学科和工具,而不是顺着惯性一直往下走。 三年后,当丁文伯准备回清华任教时,他又做了一次类似的选择。 彼时,电子皮肤研究多聚焦于材料与器件,他却把目光投向了冷门的视触觉方向。在他看来,这一方向既能借力快速发展的计算机视觉和 AI 技术,也恰好能发挥他在材料、光学与信号处理上的交叉积累。 此后,他逐渐转向机器触觉,并将这些积累带入其中。团队后来开发出的多模态触觉传感器 SuperTac,能够融合多种信号,让机…

Action from the 11 vs 11 humanoid match at RoboCup 2026. Photo credit: RoboCup Federation. RoboCup 2026 saw history made, as two teams of 11 humanoids took to the soccer field, the first time a full complement of robots has competed. The game saw B-Human (Bremen, Germany) take on HTWK Robots (Leipzig, Germany), with both […]

腾讯混元发布新一代旗舰模型 Hy4 preview,总参数 770B、激活参数 49B、上下文长度 1M,现已开源并在腾讯云 TokenHub 和 OpenRouter 上线。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmtcjzlxy03f8rodbxqdotbhg
China Life Insurance, the country’s largest life insurer, has posted record highs in its first-half results, and says it will scale up investments in technology-related sectors while seeking to become a long-term partner for innovative enterprises. The Shanghai- and Hong Kong-listed insurer recorded revenue of 434.3 billion yuan (US$64.6 billion), up 81.5 per cent year on year, according to interim results released on Thursday. Net profit surged more than 228 per cent to 134.5 billion yuan. The.…

Our decision to wind down our contract providing OpenAI models to Cursor following its acquisition by SpaceX.
谁不想在新年到来之际收到一只可爱的 AI 机器鸭呢? 距离 2026 年圣诞节还有四个月,在英伟达以约 129 亿美元收购消息曝光次日,AI 开源社区 Hugging Face 发布了一款名为 Microduck 的小机器人。它身高 25 厘米、重不足 800 克。演示视频里,它用喙叼着袜子摇摇晃晃地走路,被人推搡时会尽力稳住,即便倒下也能自己爬起来,甚至可以穿上轮滑鞋滑旱冰。 产品售价 399 美元(约合 2,700 元人民币),有奶油白、石墨灰、薰衣草紫、天空蓝四种配色可选,附赠一只游戏手柄。联合创始人克莱姆·德朗(Clem Delangue)在社交平台 X 上放出一段 50 秒的演示视频,几个小时内浏览量接近 40 万。 (来源:Pollen Robotics) 从语音互动,到“走”进真实世界 做开源大模型托管平台起家的 Hugging Face,入局具身智能的节点要追溯到 2024 年初,前特斯拉(Tesla)Optimus 团队科学家雷米·卡德内(Rémi Cadene)加入,主导开源机器人库 LeRobot 的开发;2025 年 4 月,Hugging Face 完成对法国…

机器人世界模型的下一场竞争,可能不是画质,是架构。 作者|Li Yuan 编辑|郑玄 一只机械臂的夹爪明明没有夹住杯子,杯子却像被磁铁吸住一样,跟着夹爪升了起来。这个看似荒诞的问题,正在困扰机器人世界模型,业内甚至将其称为「磁铁式抓取」。 视频生成模型只要让画面看起来合理,就算完成任务;但世界模型不能只追求「像真的」。机器人训练数据大多来自成功演示,模型容易形成捷径:与其理解动作的细微差别,不如按照画面,直接生成最可能的结果。 可在真实世界里,夹爪位置偏移几毫米,就可能让结果从抓起变成碰倒杯子甚至抓空。世界模型真正需要理解的,是动作与结果之间的因果关系。 8 月 27 日,自变量机器人发布下一尺度自回归世界模型 WALL-SS,试图让世界模型从「能用」走向「好用」。WALL-SS 不是一次性生成整个画面,而是通过由粗到细的方式描绘未来,让不同动作真正对应不同结果;同时结合长时记忆机制,实现最长 60 秒连续推演。 测试显示,WALL-SS 连续推演 60 秒后,画面和运动轨迹仍更接近真实视频,动作跟随得分达到 0.29,而 Cosmos3-Nano 为 0.044,其他测试模型干脆为 …
Beijing-based GalaxySpace’s deployed what it called China’s first turnkey satellite export to Southeast Asia this week, underscoring the country’s efforts to boost its influence in the space industry overseas amid competition with Elon Musk’s SpaceX. GalaxySpace said it launched the Lingzhi-09 Thailand CubeSat aboard a Long March-6C rocket – alongside six other satellites – from the Taiyuan Satellite Launch Centre in Shanxi province on Tuesday. Developed for Thailand’s Geo-Informatics and Space.…

SoftBank-backed surgical robotics company Noah Medical has begun preparations for a Hong Kong initial public offering, joining a wave of cutting-edge technology firms tapping the city’s international fundraising pool. The US-headquartered company aimed to raise more than US$100 million and planned to file its listing application as early as next year, according to founder Zhang Jian. “We want to expand our business in [mainland] China, and Hong Kong – as an international financial centre with a.…

We have selected seven stories from this week’s news across Hong Kong, mainland China, the wider Asia region and beyond that resonated with our readers and shed light on topical issues. If you would like to see more of our reporting, please consider subscribing. 1. The path to America is narrowing. Here’s what that means for legal immigrants US green card interviews are on hold worldwide, student and work visas are subject to new restrictions, and citizenship is under fresh scrutiny. The SCMP...
