最近,亚马逊云科技发布了 aws-bench"。这是一个开源基准测试工具,用于评估 AI 代理完成真实 AWS 任务的准确性,例如诊断配置错误、配置基础设施以及运营实时云环境。 该项目声称,他们采用了与传统静态测试环境基准测试不同的方法。该公司表示,使用在一次性真实亚马逊云科技账户中创建的实际资源,可以在一些开发人员和团队经常在 AWS 上执行的工作中更准确地评估智能代理的表现。 每个基准测试都会在隔离的亚马逊云科技账户中部署一个场景,由 CDK 堆栈中定义的一组 AWS 资源组成。当场景就绪后,待评估的智能代理会使用范围限定凭证,在沙箱容器中运行一项任务。任务完成后,结果将通过自动化验证器进行评分。该验证器可以是大语言模型(LLM)评判器,也可以是对实时 AWS 状态进行程序化检查。 该基准测试附带预定义的数据集,包含基础任务和高级任务。这些任务涵盖可观测性、计算与数据、数据库与存储、EC2 多区域、无服务器、流处理与物联网、参考架构以及多服务故障排除等用例。 尽管这次发布主要面向的是人工智能研究人员和模型提供商,但工程团队也可以尝试使用该基准测试,并通过扩展现有的场景和任务来满足自…

安全研究员 Christopher Domas 发布"了一个名为 skitter-creek-bath-salts 的开源硬件安全项目。该项目针对的是物理内存层次结构的最底层,打破了传统的 CPU 权限边界。通过操纵内存控制器转换寄存器,该工具能在硬件逻辑层动态修改物理地址与 DRAM 地址的映射关系,使没有特权的软件能够访问隔离的平台内存区域,而不会触发上游架构的内存屏障或故障异常。 现代处理器安全架构假设物理地址会确定性地映射到特定的硅基存储位置。标准安全边界——包括虚拟机管理程序的扩展页表"、系统管理模式(SMM)的 TSEG 范围限制"以及平台安全处理器(PSP)的私有预留区——都运行在 CPU 内核与系统总线互联层,处于内存流量抵达内存控制器之前的路径上。Domas 发现,内存控制器转换寄存器位于这些访问控制屏障之下。通过操纵 BankSwizzleMode" 等配置位,可以从根本上改变控制器计算 DRAM 存储体、行和列坐标的逻辑。由于上游安全过滤器仅对未经转换的物理地址进行验证,这些位翻转操作使得标准内存访问能够悄无声息地进入受保护的硬件安全区。 为了在不破坏主机操作系统…

世界人工智能开源大赛(GOAI)初赛作品覆盖企业级智能体、行业应用、AI科学研究与具身智能等领域。四大赛道方向不同,却呈现出一条共同主线:参赛团队不再只关注模型“会不会”,而是开始回答系统能否真实运行、完成任务、处理失败,并用证据证明结果。 从2999份初赛作品中,我们不仅能看到一批高质量的AI创新项目,也能观察到智能体技术、产品形态与开源生态正在发生的变化。 初赛作品呈现了哪些创新方向? 赛道一「新智基座」:多智能体走向企业系统 新智基座赛道覆盖软件研发、Agent基础设施与SRE治理、金融风控、工业制造、科研及企业运营等方向。从初赛作品可以看到,参赛团队正在告别通用问答和简单Demo,转向解决真实企业场景中的复杂任务。作品主要采用分层多Agent协作、动态编排、独立验证、人工门禁、Skill与工具接入、异常恢复和版本治理等技术路径。 这些作品试图解决企业复杂任务中的信息分散、AI结果难以直接信任、高风险动作缺少控制和组织经验难以复用等问题。相比单一智能体,团队更关心多个Agent如何分工、工具如何调用、过程如何审计、结果如何验证。 赛道二「无界应用」:AI进入真实工作流程 无界应用…

Expedia Group开源了mockql-rs",这是一个Rust CLI工具,可以在请求时从LLM生成GraphQL的模拟响应。这是过去六个月内第三次公开尝试解决这一问题,前两次分别是Airbnb在4月推出的@generateMock指令和2月份开放的GraphQL基金会RFC"。这三种方案采用了显著不同的设计,其中两种使用相同的指令名称但含义并不相同。 它们的共同前提是GraphQL选择集(GraphQL selection set)已经是一个规范。Expedia Group的软件工程师Samuel Vazquez指出了这种方法的吸引力,它颠覆了生成工具的常见失败模式,即模型不擅长创造形状,但擅长填充形状,而schema为它们免费提供了一个界限明确的形状。换句话说,就是开发者不再需要手工输入一个两百行的JSON固件文件,如果第二天早上schema发生了变更,该文件就会失效。 mockql-rs作为独立进程位于客户端和服务器之间。开发者使用@mock注解标注字段以及可选的提示,该工具使用apollo-compiler解析并验证针对schema的操作,将被注解标注的字段与真实字段分…

一张显卡,开始被越来越多创作者当成生产资料重新算账。 过去,要把AI视频真正搬到本地,首先卡在模型。效果更好的视频模型大多通过云端服务提供,能够下载到本地的开源模型,距离稳定生产往往还有一段距离。 但今年夏天发生了变化。在MiniMax开放新一代视频模型H3权重的同一天,英特尔宣布锐炫Pro B70完成H3的Day 0适配。这张几个月前才发布的32GB专业显卡,由此有了一个更加具体的本地视频生成负载。 当模型能下载,显卡也能跑,本地AI视频的创作和生成也迎来新的挑战。日前,英特尔联合MiniMax、数字折叠举办AIGC创作研讨会。现场的讨论并没有局限于显存和峰值算力,而是更关注一套贴近实际生产的本地算力:它究竟能完成多少工作、如何支持多人共享,以及新模型出来后能否及时跟进等。 英特尔想抓住的,正是这个变化。 多卡开工,本地AI有了「生产线」 AI视频工具正在变成创作者的常用助手。 Adobe针对384名美国视频内容创作者的调查显示,71%的受访者已经使用过AI视频生成或编辑工具,其中41%的使用者每周都会使用。 使用频率上升,也让云端模式原本不明显的成本被放大。 一条视频往往不是生成一…

DeepSeek released V4-Flash-Vision-Exp on Hugging Face under an MIT license, bringing image input to its V4 series for the first time.

今日,在2026年亚太经合组织(APEC)中小企业数智赋能论坛上,作自变量机器人联合创始人兼COO杨倩为参会的唯一具身智能企业代表,发表《开源无界,亚太共融——构建可信包容的具身智能生态》主题演讲,分享具身智能与开源生态结合的实践与思考。 杨倩表示,中小企业是亚太经济发展的重要力量。随着具身智能加速从数字世界走向物理世界,机器人正为中小企业数智化转型提供新的技术路径,开源则进一步降低技术获取和应用门槛,让更多企业、开发者和年轻人参与技术创新。 具身智能为中小企业提供转型路径 数据显示,中小企业约占APEC成员经济体企业总数的97%,贡献超过一半的就业和40%以上的GDP。当前,不少中小企业面临用工成本上升、招工难以及数字化人才不足等问题。 杨倩表示,具身智能能够通过感知环境、理解指令并自主完成任务,降低企业使用机器人的技术门槛;其环境适应能力也有助于减少对现有生产线的大规模改造,并适应多品种、小批量等生产需求。 从“6个月”到“3天”,开源降低具身智能创新门槛 今年3月,自变量机器人举办全球具身智能开发者大会“具亮计划”,吸引上百支来自高校、企业以及亚太地区的年轻团队参与。一支团队在活…

最近一年,具身智能行业里的数据采集设备明显多了起来。入局者众多,很容易让人产生一种印象,数采硬件已经没有多少技术含量,做出一套设备似乎并不难。 但过去一年,我们采访了不少具身智能数据公司。一个越来越明显的感受是,行业已经不太缺“快速、大量采数据”的方案,真正稀缺的是能够稳定进入模型训练,并最终带来模型能力提升的数据。 数采设备越来越多,并不意味着高质量的第一视角数据已经变得容易获得。事实上,我们听到过不少因为数据质量问题拖慢甚至影响模型训练的案例。 最近,开源数据集 Xperience-10M 背后的 Physical AI 数据基础设施公司 Ropedia,发布了新一代第一视角多模态采集设备 HOMIE Gen2。 在 HOMIE Gen2 发布之前,Ropedia 的上一代设备已经被用于生产 Xperience-10M。这套数据集开源后,又陆续进入 Qwen、Ai2 等团队的模型训练。 据 AI 前线了解,从第一台原型机到今天的 HOMIE Gen2,Ropedia 的采集设备在约十二个月里迭代了四代。2025 年 6 月,团队用 3D 打印结构件搭出第一台第一视角采集原型机“竹蜻…

GLM-5.3 现已开放权重。 我们最强大的智能体编码与网络防御模型,现已可供下载、运行和定制。 权重:https://huggingface.co/zai-org/GLM-5.3 技术博客:https://z.ai/blog/glm-5.3 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmtd32q060c3vroq546ccqp7r
“在顺雨与研究团队的努力下,Hy4将会迎来更多突破与更大的进步,大家可以拭目以待。但眼睛也不能只盯着模型这一层。”汤道生前两天在内部署名文章中说的,现在终于来了。 今天,腾讯发布了混元Hy4 preview,总参数 770B、激活参数 49B,上下文长度突破 1M,重点面向Agent、Coding与生产力场景优化,增强在真实业务场景中完成复杂任务的能力。 据悉,相比上一代,Hy4 preview在多步骤Agent、代码开发和生产力任务上进一步提升,尤其是在更好的任务拆解、上下文承接、指令遵循和长链路执行能力上。 在Coding场景中,进一步增强代码理解、生成、修改和复杂工程任务处理能力;在生产力场景中,重点提升文档处理、信息分析、办公自动化、游戏开发、网页生成及跨工具协作等能力;在游戏开发场景中,增强了一句需求直接生成可玩原型能力,并能熟练使用游戏引擎,开发者可以通过多轮交互持续完善复杂游戏项目;在科学研究场景下,提升复杂科研问题的理解、推理与求解能力。 值得注意的是,Hy4 preview 在自身研发的全链路过程中发挥了积极价值,首次参与训练方法、数据策略、评估体系和底层算子的自动优…

On August 28, Tencent Hunyuan released and open-sourced Hy4 preview, its next-generation large language model with 770 billion total parameters and a context window exceeding 1 million tokens.

前两年,我在河南、河北、东莞、深圳等地,认识过一批「AI 玩具公司」。 它们做的事情大体相似:定制一个手办,再给它加上语音对话;或者把语音模组塞进毛绒玩具,让一个普通玩偶可以和人聊天。一些公司甚至借着 AI 的新鲜感迅速出海。 2024 年前后,这件事情本身还有一定的技术门槛。要让一个玩具真正开口,需要把主控、麦克风、联网等硬件,与 ASR、LLM、TTS 等软件服务串起来。对于传统玩具厂商和 IP 方来说,这已经超出了原本熟悉的能力范围。 但这两年,AI 硬件的开发门槛下降得越来越快。 3D 打印、PCB 打样和成熟开发板越来越容易获得,开源社区也已经提供了大量现成方案,从语音对话到舵机、电机控制,都可以找到较为成熟的项目。 最近,我们拿到了这样一块近乎「傻瓜式」的 AI 模组。不用写代码,在开发平台选好模型、音色和角色,几分钟就能让它开口说话。再塞进一个毛绒玩具,一款最基础的 AI 玩具就有了。 做出这块模组的是一家 2025 年成立的澜存科技。 澜存目前有两个核心产品:澜卡 LC-1.7 系列标准 AI 模组,以及配套的澜存智能平台。前者集成语音、联网和多种硬件接口,可以继续外接…

MoK:把 token 调度、跨 GPU 通信和专家计算塞进同一个 GPU 内核。 作者丨郑佳美 编辑丨岑 峰 7 月 21 日,NVIDIA 公布了 GB300 NVL72 训练 DeepSeek-V3 的最新成绩:256 张 GPU 上,单卡性能达到 1,648 TFLOPS。 不到两周后,Cursor 开源了 Mixture-of-Kittens,简称 MoK。它没有继续折腾更快的矩阵乘法,而是直接重写了一层 MoE 的执行方式,把 token 调度、跨 GPU 通信和专家计算塞进同一个 GPU 内核。 这件事有点反直觉。因为 GB300 NVL72 已经把 72 张 GPU 放进同一个 NVLink Domain,整机架 NVLink 总带宽达到 130 TB/s。按这个规格看,GPU 之间传数据应该已经足够快。 可在大规模 MoE 训练里,通信依然会拖住专家计算。 问题出在 MoE 的数据流。Router 每一步都会重新决定 token 去哪个专家,而专家分散在不同 GPU 上。token 要先跨卡送过去,算完再传回来;发送之前还要整理位置,到达之后还要等待数据完整。随着 M…

腾讯混元发布新一代旗舰模型 Hy4 preview,总参数 770B、激活参数 49B、上下文长度 1M,现已开源并在腾讯云 TokenHub 和 OpenRouter 上线。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmtcjzlxy03f8rodbxqdotbhg
谁不想在新年到来之际收到一只可爱的 AI 机器鸭呢? 距离 2026 年圣诞节还有四个月,在英伟达以约 129 亿美元收购消息曝光次日,AI 开源社区 Hugging Face 发布了一款名为 Microduck 的小机器人。它身高 25 厘米、重不足 800 克。演示视频里,它用喙叼着袜子摇摇晃晃地走路,被人推搡时会尽力稳住,即便倒下也能自己爬起来,甚至可以穿上轮滑鞋滑旱冰。 产品售价 399 美元(约合 2,700 元人民币),有奶油白、石墨灰、薰衣草紫、天空蓝四种配色可选,附赠一只游戏手柄。联合创始人克莱姆·德朗(Clem Delangue)在社交平台 X 上放出一段 50 秒的演示视频,几个小时内浏览量接近 40 万。 (来源:Pollen Robotics) 从语音互动,到“走”进真实世界 做开源大模型托管平台起家的 Hugging Face,入局具身智能的节点要追溯到 2024 年初,前特斯拉(Tesla)Optimus 团队科学家雷米·卡德内(Rémi Cadene)加入,主导开源机器人库 LeRobot 的开发;2025 年 4 月,Hugging Face 完成对法国…

行业将Hugging Face 130亿美元出售探价误读为现金流危机,但其经营基本面并无现金流压力。本文从信任资产属性、资本逻辑冲突出发,拆解AI开源分发枢纽特有的悖论:生存仰仗中立,控股式资本交易却极易摧毁中立,并区分短期现实路径与长期产业稳态。
arXiv:2608.26505v1 Announce Type: new Abstract: The Poppy Humanoid is an open-source, low-cost robot suitable for research and education in artificial intelligence. However, we are unaware of any published methodology that achieves reliable, unassisted bipedal locomotion on the standard Poppy hardware. This paper contributes a functional closed-loop walking controller for Poppy, based on the linear-quadratic regulator (LQR) framework for trajectory tracking. Starting with data collected from ope…
英伟达收购Hugging Face引发了开发者群体担忧,对于中国开源生态来说,风险亦在增加。

站在 2026 年 8 月北京世界机器人大会(WRC)的展馆中心,如果你闭上眼,听到的不再是两年前那种对“机器人像人一样跳舞”的惊呼,取而代之的,是从业者们在心里拨动算盘,计算 ROI(投资回报率)的声音。 具身智能正在经历一场从“秀肌肉”到“翻账本”的集体变轨。 回看这半年的轨迹,这种趋势演进得极具层次感: 5 月的维也纳 ICRA,学术界和产业界第一次如此默契地把所有火力都集中在了 VLA(视觉-语言-动作)模型上,那是具身智能的“物理学补课期”; 7 月初的上海 WAIC,200 多家具身智能企业同台竞技,集体把演示从“后空翻”换成了“拧螺丝、叠衣服”,那是行业的“场景落地焦虑期”。 7 月底的悉尼 RSS,开源硬件、仿真工具链和遥操作数据方案成为主角,行业开始为“大脑聪明、身体廉价、数据贫瘠”搭建公共底座,那是产业的“基础设施奠基期”。 而在 8 月的北京 WRC,所有话题似乎都围绕工程约束和商业底线展开。在这里,没人关心你的模型是否有哲学意义上的“意识”,大家只盯着三个指标:多少钱?多稳?跑一个月能省几个人的工资? “以前我们聊的是什么时候 AGI,现在我们在聊这台机器人跑一…

GLM 5.3 Flash与Qwen3.8 Flash同日发布,价格战成为焦点:输入0.8元、输出2.8元每百万Token,与DeepSeek的价差没有想象中大。作者把两个模型放进同一环境A/B跑一周看谁更省钱,并实测前端与3D游戏生成能力。 GLM5.3 flash和Qwen3.8 Flash同一天发布了,上周我还猜牛来模型是小米MiMo,不过很快就有人用分词探测器实锤是GLM系的模型了。那来都来了,先来对比一下争议性很大的价格问题, GLM 5.3 flash现在是每百万Token输入0.8元,输出2.8元,DeepSeek因为分时间段,我就直接拉一个图来对比了。 但5.3本身会通过多尝试增加轮次来提升准确性的,跟DeepSeek基本上往99%打的缓存对比,我只能说价格差没有想象中大。 最简单的方式就是做A/B test,把deepseek v4 flash和GLM 5.3 flash放到同一个环境跑一周看看哪个省钱。 老粉应该知道我在上上周开源了一个AI提示语案例网站goodcase,现在已经录入700个带完整提示语的case了,里面的提示语,case摘要,skill生成都是de…

据Business Insider报道,英伟达近期一直在与 Hugging Face 洽谈收购事宜。Hugging Face 是一个备受欢迎的、用于分享开源模型以及基于开源模型进行开发的AI 平台。如果交易最终达成,这可能成为这家芯片巨头迄今规模最大的交易之一。 据知情人士透露,双方最近几周已经就收购展开谈判,这笔交易对 Hugging Face 的估值可能超过 130 亿美元。目前双方尚未达成协议,谈判仍有可能破裂。 不过,The Information报道称,英伟达已同意以 129 亿美元收购 Hugging Face。截至发稿,双方均未对此做出回应。 而就在该消息曝出前数小时,英伟达发布了最新的季度财报。 在最新的2027财年第二季度财报电话会上,黄仁勋判断,客户对英伟达算力的需求明年可能增长约100%,但受供应限制,公司目前只能有把握实现约70%的营收增长。英伟达预计,至少到2028财年结束,供应仍将是主要瓶颈。 需求的拐点是,AI从“人发起一次请求”迅速转向“智能体持续工作”。黄仁勋称,一个AI智能体完成任务所需的计算量,可能是人类直接使用AI时的15—100倍。就在过去一个…

昨晚,孙割写的小作文爆火。 具体的小作文详情我就不放了,应该传的满天都是,感兴趣的可以去孙割的GitHub上看。 但是就别问我孙割具体的GitHub链接是什么,你可以直接复制这个问题去问AI。 哦对了,如果不认识孙割是谁的,也可以去问AI。 真的,八卦和吃瓜,真的就是人类的天性。。。 不过呢,我的朋友圈里,可能都是搞AI的,除了吃瓜之外,大家讨论的更多的,除了Claude击碎了孙割的恋爱脑之外,还有孙割的文章写的真不错。 而且细节极多,情绪又极其克制,在不经意间让你感受到了情绪的暴击,就跟孙割割你韭菜一样,一不留神就被割的原地痛苦,泪打湿了键盘,又想起了那些曾经的白月光们。 不过讲道理,在文学中,还真的有一种手法,叫白描。 就是用很少的修饰、很克制的语言,抓住最有特征的细节,把人或场景直接写出来。 孙割大量地用了这种手法,比如这一次真正的拒绝。 普通网文可能就会写“那一刻,我的内心无比挣扎,我知道我们的感情已经走到了悬崖边。” 这就是孙割的精明之处,精髓和神韵,直接就是一个精准的拿捏。 还有比如各种极其精确的数字。 而且把物品的象征意义也玩的炉火纯青。 比如整篇文章里面那个核心意象指甲…

Perplexity AI 推出 Portable Computer,明基推出 Creative Pro PV50 系列专业显示器。查看全文
Nvidia Corp. has reportedly bought Hugging Face Inc., a startup with a popular platform for hosting open-source artificial intelligence projects. Reports that an acquisition was in the cards first leaked on Monday. Business Insider broke the news that Hugging Face had received interest from multiple prospective buyers. On late Wednesday, The Information reported that Nvidia […] The post Nvidia reportedly acquires AI project hosting platform Hugging Face for $12.9B appeared first on SiliconANGLE.