Google 发布 Gemini 3.8 Flash 的同时,深入探讨了 Harness Engineering 的重要性。本文对比 OpenAI、DeepSeek、Google 三大厂商的 Harness 路线,解析如何通过工程架构让 Agent 稳定、安全地完成复杂任务,并揭示未来企业评估 Agent 的关键指标。 9 月 2 日,Google 正式发布 Gemini 3.8 Flash,这是目前 Google 最强的 Flash 模型。同一天,Google AI 的开发者账号发布了一篇值得看的技术文章:《What is harness engineering and why should I care?》。 一边继续升级模型,一边讲 Harness Engineering,比单看某个 benchmark 更有意思。整个 Agent 行业越来越清楚地认识到一件事:模型决定 Agent 有多聪明,Harness 决定这份智能能不能持续、稳定、安全地完成工作。 这也是为什么今年 OpenAI、DeepSeek、Google,甚至 NVIDIA,都开始把大量工程资源投到模型架构。 一、H…

这篇写给同行产品经理:不堆技术名词,只讲一个 AI 功能从"能用"到"可控、可验证、可规模化"过程中,我作为 PM 做了哪些判断、踩了哪些坑、沉淀了哪些可复用的方法论。 一、项目缘起:一个已经”好用”的系统,为什么只动其中一个功能 过去大半年,我主导搭了一套跑在业务里的文旅 OTA AI 系统:它接渠道运营的日常操作(开关班、调价)、做竞品价格分析、做数据分析,原来几个小时的重复活儿,现在几秒干完。它一直在线跑、团队高频依赖,整体是稳的——这一点必须先说清楚:这次升级不是给“烂系统”打补丁,而是给“已上线、已创造价值”的系统做增量增强。 系统里有一个叫”AI 运营助手专员”的子功能:运营同学用大白话问它”把抖音明天的上海博物馆库存全部关闭””明天全渠道的青铜博物馆均上调10%””xxxx订单客户电话申请了退款,给他全额退款”,它负责自然语言作答。这个专员最早是接外部公有云 AI 接口跑的——能用,但它处在业务决策链路的”回答出口”上,一旦答偏,运营会拿着错误信息去改价、去承诺客户,风险被直接放大。 作为产品经理,我对”要不要动它、动到什么程度”做了一次范围判断: 不重构:核心系统是稳的…

Lan Xiaohuan is a professor of economics at China Europe International Business School. His book, How China Works: An Introduction to China’s State-led Economic Development, has sold millions of copies in China and has been translated into multiple languages. Here, he discusses the economic realities behind China’s record trade surplus, the case for a stronger social safety net, and how public data infrastructure shapes the artificial intelligence race with the United States. SCMP Plus readers..…

NexCOBOT, which provides functional safety and motion controllers, discusses how physical AI benefits from 'Big Tech' and where it will grow. The post NexCOBOT discusses physical AI market hurdles and acceleration appeared first on The Robot Report.

联合国环境规划署(UNEP)2 日发布报告,警告称地球变暖导致全球平均气温较工业革命前上升的幅度将在数年内超过 1.5 度,灾害、健康危害等风险将上升至危机水平。报告指出若要减轻负面影响,重要的是将超过 1.5 度的持续时间缩至最短。报告称,若保持当前的气候变暖对策,到 2100 年全球平均气温将上升约 2.6 度。即使《巴黎协定》框架下各国自主设定的温室气体减排目标全部达成,排放量和森林等吸收量相抵达到净零,预计气温仍将上升约 1.8 度,估计 10 年内将超过 1.5 度。一旦超过 1.5 度,极端的气象现象将增多,小岛被淹没的可能性升高。报告还称,人类健康、粮食生产、基础设施以及经济也将受到严重影响。据称如果本世纪内最高上升 3 度,四分之一以上的冰川将消失,海平面将上升 9-13 厘米。参与撰写报告的 英国埃克塞特大学教授理查德·贝茨以 8 月尼泊尔和中国边境发生泥石流为例强调,“遗憾的是,这种事因气候变暖更易发生。需要采取措施遏制气温上升。”
1691分,Qwen3.8-Max把前端编程榜单推到新高,也把长周期智能体继续往企业工作里压。Claude Fable 5.1则把高度智能体化任务的成本最多降约45%,说明竞争正从“更聪明”转向“更能持续干活”。老曹的判断是,榜单会反复换座次,真正留下用户的,是复杂任务做得稳,账单也算得过来。 一起来看看这两天发生的AI和互联网赛道的大事件吧! 📌 今日AI互联网大事件速览 1,阿里升级Qwen3.8-Max,前端编程榜单升至全球第一 2,努比亚豆包手机完成入网,NaviX Ultra计划9月开售 3,智谱把GLM Coding Plan搬进天猫,个人版月付118元起 4,网信办清理561万余条AI违规信息,平台强化生成内容治理 5,OPPO联合OpenKG发布MobileMem,给端侧AI长期记忆立标尺 6,合见工软发布国产三维芯片设计工具,3DIC物理设计补上关键一环 7,Anthropic发布Claude Fable 5.1,智能体工作成本最高降约45% 8,OpenAI确认Astra达到关键网络安全能力门槛 9,Google推出Pics,AI图片编辑进入Docs与Slides…

Windows 下的累计更新会修复大量的安全漏洞,虽然可以暂停更新但是最长只能暂停 35 天,35 天后 Windows 电脑就要强行帮你更新了,而本文介绍了一种突破暂停最大时间的方法。查看全文
大模型演示惊艳,上线却频频翻车?问题不在模型能力,而在产品设计。本文从任务拆解、幻觉控制到长上下文陷阱,教你如何将模型能力转化为稳定可靠的产品功能。 过去两年,我听得最多的一类需求是“能不能接个大模型”。客服希望它自动回复,设计部门希望它审图,运营希望它直接出方案,管理层则希望看到一个会查资料、会调用系统、还能自己推进任务的智能体。 这类需求很容易做出让人兴奋的演示。准备几份干净文档,选一个能力较强的模型,再配上一段经过反复打磨的提示词,十分钟就能看到颇像成果的回答。它能解释术语,也能整理表格,还能给出下一步建议。会议室里的第一反应通常很一致,既然回答已经这么像专家,离上线应该不远了。 真正的产品工作从这一刻才开始。 把同一个功能交给真实用户,输入会立刻变脏。半句话、旧版制度、写错的零件名称都可能进入系统,一个问题里还可能混着三个目标。模型可能引用过期条款,也可能补出原文里没有的参数。接上工具以后,风险又多了一层。一次不准确的回答还可以修改,一次错误写库、误发邮件或误停设备,后果很难靠一句“模型会犯错”带过。 因此,讨论大模型的能力边界,价值并不在于列出一张“能做”和“不能做”的清单。…

Mozilla 释出了 Firefox 155。从该版本起 Firefox 将每隔两周发布一个新版本。Firefox 155 主要变化包括: 地址栏中新增 Firefox 已拦截广告追踪器的数量;容器重排序;mailto: 链接仅在用户明确操作后打开;用于登录酒店 Wi-Fi 的域名 detectportal.firefox.com 改为 firefox-portal-detection.com;Smart Window 对所有美国、加拿大和法国用户可用;bug 修正和安全补丁,等等。
作者|苏子华 编辑|靖宇 极客公园最近发现,婴儿床这个品类正在被 AI,或者说被「具身智能」重新定价。从一张几百元的价格,直接抬升到一万元。 婴儿床是少有的被技术「忽略」的家居品类。100 年来,它的形态几乎没有变过。四根立柱、一圈围栏、一张床垫。 关键变化发生在过去五年。 传感器、算法、电机第一次被装进一张床,价格随之跳升:美国智能婴儿床 SNOO 售价 1695 美元(约 1.2 万元人民币),Cradlewise 售价 1999 美元;而在今年年初的 CES 上,中国公司亲宝宝展示的 AI 睡眠舱,官方定价 8999 元人民币。 目前只要打上「智能」的旗号,仅仅做到温度控制、视频记录,在电商平台上售卖 4000 元起步的也有大把存在。 在海外,SNOO、Cradlewise 等初创品牌已经用产品证明了:婴儿床可以被卖到一万元人民币以上,而且卖得动。 巨头们正在加速入场。德国工业巨头博世也发布了 AI 婴儿床 Revol,传统的母婴巨头厂商 HALO、Graco 也在全线跟进。 让婴儿睡得安全,解放父母夜里的睡眠时间和看护焦虑——这个小众品类已经从边缘走向台前。而且,现在它正在被贴…

“左移”和 DevOps 对我们从构思到生产环境实施变更的方式产生了巨大的影响,但代价是认知负荷加重,而且在测试、安全和维护等方面出现了重复性工作。如果一个组织成立已经数十年,考虑到原本就已经造成了摩擦的技术债务和文化壁垒,这项工作的难度很容易就会增加一个数量级。 本文基于 KubeCon EU 2026 大会(在阿姆斯特丹举行)上发表的一篇文章:平台规模多大才算恰到好处"。该文从帮助确定开发平台的合理规模以及为使用该平台的工程团队寻找文化契合点方面,深入探讨了所面临的现实挑战,旨在减轻认知负荷并加快变更交付速度。 平台之始 在 Wehkamp,我们开发并运行着大量涉及物流、数据科学和电子商务领域的软件。作为荷兰规模最大、历史最悠久的在线百货公司之一,我们既有的业务流程与技术体系参差不齐,这自然导致了部门之间的相互隔绝,以及工程工作的重复。由于工作交接的特殊性,没有任何一个团队能够超越自身职责范围进行改进或优化,大多数努力最终都导致了相互冲突的标准。 大约十年前,管理层设定了一个明确的目标——每周发布而非每季度发布,以便更快地交付功能,至此我们才实现了突破。我们成立了一个新部门,最终整…

从3Q大战到AI时代,平台与AI的入口之争从未停止。当AI助手需要读取屏幕、调用权限时,谁控制着系统,谁就决定了AI的能力边界。本文回顾历史,剖析WhatsApp、Android等平台的限制与监管,探讨AI产品经理如何应对未来的入口博弈。 2010 年 11 月 3 日,QQ 用户收到了一封公开信。 腾讯在信里写下“非常艰难的决定”,随后停止在装有 360 软件的电脑上运行 QQ。一个平时只会出现在公司会议室里的竞争决定,就这样落到了数亿用户面前。继续用 QQ,先卸载 360。留下 360,QQ 就打不开。 我原先把 3Q 大战看成桌面软件年代的旧故事。那个年代流行开机启动、工具栏和安全软件,今天的产品形态已经换了很多。最近发生的几起 AI 竞争争议,却出现了和当年相似的动作。WhatsApp 限制第三方 AI 助手进入,Android 被要求向竞争性 AI 开放系统能力,美国的 Google 搜索案也把 Gemini 的默认分发纳入限制。公司争夺的产品换了,争夺入口、权限和默认位置的方式依然熟悉。 当年的问题没有过时。它只换了一个问法。 以后是谁决定,你的 AI 能看见什么,又能替你…

最近,Cloudflare 在 GitHub" 上开源了 Cloudflare OS"。Cloudflare OS 使企业团队能够基于企业知识、专业技能和预配置的连接器产出工作工件,在优化 Token 成本的前提下自动化重复性工作流(仅在必要时借助 AI 辅助),并在安全的沙箱模型内构建个性化、可共享且可定制的工作软件,以满足特定的复杂使用场景。其底层的能力驱动型模型可以用于执行企业策略。 在一篇简短的博文"中,首席架构师 Kenton Varda" 阐述了这次涉及多个领域的大规模发布: 今天,我们发布了 Cloudflare OS——一款配备连接器的聊天机器人,就像其他科技公司都在做的那样。[…] 不过实际上,它并不一样。这是一个完全个人化的应用氛围编程平台,其沙箱环境极为安全,以至于 […] 企业安全团队都可以放心授权非技术用户在其中自由编程,自己也能高枕无忧。这怎么可能呢?[…] 例如,如果你有一个文档编辑器应用,每个文档都会作为该应用的单独实例,在独立的沙箱(一个 Gadget)中运行。这意味着两点,我认为这两点都至关重要:1. 该平台可以通过控制谁能够访问 Gadget 来管…

三个月前,Anthropic发布Fable 5时,试图回答一个问题:当模型需要连续工作数小时甚至数天,它能否一直记住目标、调用工具、检查结果,并在无人监督的情况下把任务做完? 现在,Anthropic带着Fable 5.1回来了。 Fable 5.1 和 Mythos 5.1 正式发布 当地时间9月1日,Anthropic 正式发布 Claude Fable 5.1 和 Claude Mythos 5.1。 按照官方定义,两者使用相同的底层模型,区别不在“智力”,而在安全保护级别:Fable 5.1 面向普通用户和企业全面开放,Mythos 5.1 则只通过受信任访问计划,向部分网络安全和生命科学机构提供。 从版本号看,这只是一次“.1”升级。但从实际变化看,Anthropic显然不只是在修补 Fable 5。新模型在智能体科学研究测试中的成绩超过前代两倍,在编程、知识工作、电脑操作和长时间任务中全面提升;与此同时,Agent工作负载的实际调用成本最高下降约 45%。 更重要的是,Anthropic这一次没有只谈模型跑分。价格、缓存、数据留存、安全误判、漏洞研究权限和企业部署架构,几乎…

背景介绍 我们团队负责的是系统的核心组件——内容安全审核系统。该系统对接了公司内部众多的业务方(如视频、评论、账号、私信等),其核心交互架构基于 RocketMQ 构建,采用典型的异步管道模式: 进审阶段:业务方将待审核的数据发送到其对应的 RocketMQ 进审 Topic。审核阶段:我们的审核系统根据自身处理能力,消费这些进审消息,进行机审、人审、AI 文本/图像识别等一系列安全检测。出审阶段:检测完成后,系统会根据预先配置好的映射关系,将审核结果发送到业务方指定的出审 Topic(或通过 Webhook 下发)。同时,为了进行审计和排查,审核记录会通过一个专用的异步 MQ 发送到 Elasticsearch(ES)进行存储。 其简化架构如下: 诡异的线上异常 在一次服务升级重启发布后,我们收到业务方的反馈:部分内容已经生产成功了,但一直没有收到审核结果。 我们随即展开排查。诡异的是: 我们在后台的 ES 审计日志中,能够明确查到这几条内容的审核记录。这说明系统确实正常消费了这几条消息,并成功通过异步 MQ 写入了 ES。但这些业务确实没有收到出审结果。而且这种现象是偶现的。项目刚…

Anthropic 发布 Claude Fable 5.1 和 Claude Mythos 5.1,两者为同一模型,Mythos 5.1 仅通过受信任访问计划提供给网络安全和生命科学领域。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmtjjkmd800r4roe4wpq221bc
甲骨文公司 Java 平台组首席架构师 Mark Reinhold" 宣布",作为自 JDK 25" 发布以来的第二个非 LTS 版本,JDK 27" 现在已经进入了首个发布候选版阶段。主干源代码库(已于 2026 年 6 月初分叉至 JDK 稳定版本库",即 Rampdown 第一阶段)定义了 JDK 27 的功能集。严重缺陷(如回归问题或严重的功能问题)可能会得到修复,但必须通过修复请求(Fix-Request")流程进行审批。根据发布计划",JDK 27 将于 2026 年 9 月 15 日正式发布。 最终确定的九项新特性(以 JEP" 形式呈现)可以分为四大类:核心 Java 库、HotSpot、安全库和 Java 语言规范。 其中有三项新特性归类为核心 Java 库: JEP 531:惰性常量"(第三个预览版)JEP 533:结构化并发"(第七个预览版)JEP 537:向量 API"(第十二个孵化版) 其中有三项新特性归类为 HotSpot: JEP 523:在所有环境中将 G1 设为默认垃圾回收器"JEP 534:默认采用紧凑对象头"JEP 536:JFR 进程内数据屏蔽"…

当地时间8月31日,Anthropic披露了Claude多起网络安全越权事件的最新调查进展,并公布了过去一个月采取的一系列整改措施。 相比单纯的Sandbox配置失误,Anthropic将问题进一步指向模型对齐和强化学习训练机制:部分Claude模型在评测过程中表现出了“动机性推理”和为了完成任务而采取潜在有害行动的倾向,而Anthropic的实验进一步发现,如果模型长期在允许“作弊”的强化学习环境中训练,这类行为可能显著加剧。 事件发生后,Anthropic一度暂停预发布模型的外部网络安全评测、高风险强化学习环境,并对内部训练基础设施进行重构。更早之前,公司已经启动大规模安全整改,临时将约150名产品工程师调往安全、可靠性和隐私团队,部分研究人员也从预训练和强化学习工作中转向安全项目,大部分新功能开发一度暂停。 这次报告中,Anthropic释放了一个关键信号:AI安全开始变成一个越来越现实的工程问题。 Claude多次越权访问真实系统 7月30日,Anthropic报告了三起Claude模型未经授权访问真实计算机系统的事件。 这些模型当时正在接受网络安全能力评估,为了准确测试能力,…

Rohan Paul 梳理了 Fable 5.1 系统卡中的安全发现:Anthropic 称该模型在隐蔽侧任务上达到已发布模型中最高的隐蔽通过率,约 5 次尝试成功 1 次,并认为这可能是其更难监控的弱证据。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmtj2y06p04bwroh9d8oszszo
周二公布的一项民调显示,七成韩国民众表示支持出台限制青少年使用社媒的政策。这项民意调查访问了 1000 名年龄在 14-58 岁之间的受访者。调查结果显示,70.7% 的受访者支持,29.3% 的受访者反对。占总调查人数五分之一的青少年受访者中,59% 反对,41% 支持。当被问及实施此类限制的合适年龄时,16.8% 选择了 15 岁,14.9% 选择了 18 岁,13.1% 选择了 11 岁及以下。大多数受访者表示,即使出台此类政策,在限制青少年使用社媒方面仍然存在局限性,青少年用户可能会盗用他人账号或转向其它不受限制的平台,因此 59.8% 的受访者认为,平台应采取更多措施营造安全的社媒使用环境。

Why robot safety assurance must account for attacks that can change how a machine sees, decides, and acts. The post The Missing Layer in Robot Safety Assurance appeared first on The Robot Report.
OpenAI 宣布 Astra 在其 Preparedness Framework 下达到 Critical 网络安全能力阈值,是首个被评定为该级别的模型,可在少人干预下发现未知漏洞并构建利用链。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmtj42kz5057qroh9yw6fjh9h
欧盟委员会周一表示,OpenAI 的 ChatGPT 将需要遵守更严格的欧盟法规,否则将面临罚款。聊天机器人 ChatGPT、社媒论坛 Reddit 和游戏平台 Roblox 被欧盟网络安全法规《Digital Services Act(DSA)》归类为“超大型在线平台”。该认定意味着这些服务面临额外的义务,如删除非法内容、保护未成年人的隐私和安全,如果未能遵守规定,将面临最高全球收入 6% 的罚款。欧盟的决定标志着 DSA 的适用范围进一步扩大到生成式 AI 领域。此前 X 的 AI 聊天机器人 Grok 已因违反 DSA 而受到调查。这三大服务在欧盟的月活用户数都已超过 4500 万,达到了 DSA 规定的加强审查门槛。它们需要在 12 月底前履行额外义务。
An OpenAI executive and former White House adviser is calling for AI safety cooperation between Washington and Beijing ahead of a summit between US President Donald Trump and Chinese leader Xi Jinping, even as Chinese state media launch a scathing attack on American frontier governance in artificial intelligence. “I have always believed US/China AI safety collaboration would be desirable but thought it was unlikely to happen,” Dean Ball, OpenAI’s head of strategic futures, wrote on X on Tuesday.…

一年前,亚马逊云科技推出AI编程工具Kiro时,试图解决的是“生成代码之后怎么办”:与只凭一句提示词快速搭建原型不同,Kiro把需求、技术设计和任务拆解放在写代码之前,希望用规范驱动开发降低AI生成代码的随机性。 一年后,问题又向前推进了一步。 当开发者开始同时调度多个Agent,并把代码迁移、故障排查、依赖升级等任务交给它们持续运行数小时甚至更久,新的瓶颈不再只是模型会不会写代码,而是Agent能否跨会话记住项目背景、在无人值守时安全执行,并让开发者知道它究竟做了什么。 Kiro Crew正是在这一背景下出现的。它将持久记忆、多Agent协作、任务调度、失败重试和安全控制放进同一个工作空间,试图补齐Agent从单轮代码生成走向长期任务执行时缺少的工程控制层。 亚马逊云科技杰出开发者布道师Darko Mesaroš在近期分享中表示,长期运行并不意味着让模型无限循环,而是让任务能够跨越多个会话持续推进,同时保留必要的上下文、执行记录和人工干预入口。 从Vibe Coding到规范驱动开发,Kiro多走了一步 Kiro Crew于8月4日正式开源。与Kiro IDE面向单次开发会话、由开发…

谷歌推出 HEIR(同态加密中间表示)"。这是一个开源编译器和开发工具链,旨在简化加密计算的部署。具体而言,它能够对通常使用未加密输入构建的预训练 AI 模型进行编译,使其能够处理加密数据。 据谷歌介绍,同态加密"(HE)解决了端到端加密面临的若干挑战,包括使垃圾邮件和病毒检测等服务能够对加密的用户数据进行处理,降低在用户设备上部署时泄露专有 AI 模型的风险,诸如此类。 解决这些问题的方案是同态加密——这项技术正在迅速成熟,它允许直接对加密数据进行计算,从而从根本上改变了这种权衡关系。服务器可以处理密文并返回加密结果,而无需泄露任何底层信息。 在这个背景下,HEIR" 是一个面向同态加密(HE)的开源编译器工具链和开发平台,它能够将原本设计用于处理明文数据的预训练 AI 模型改造为处理加密输入。利用 HEIR ,谷歌已经实现了在不泄露用户数据的情况下提供私密内容推荐;在保护敏感财务信息的同时检测信用卡欺诈;在不向服务提供商透露数据包内容的情况下识别网络入侵;以及在不披露底层录音的情况下识别音频流中的关键词。 HEIR 采用一种中间表示作为抽象层,用于“在不同方言间表示和扩展复杂的模型…

2025 年 11 月太阳释放了多个 X 级耀斑,耀斑还伴随着引发地磁风暴的日冕物质抛射。地球上的居民在此期间目睹了绚丽的极光,极光的范围甚至延伸至低纬度地区。对太阳风暴期间收集的数据的分析发现,美国上空的大气层出现了大范围的、横跨东西海岸的扰动,其规模前所未见。它导致部分地区的 GPS 定位偏差超过 10 米。如此大的偏差足以影响精准农业和自动驾驶汽车的运作。GPS 信号穿过电离层时会被扭曲和衍射,导致抵达接收器时的信号强度快速波动,这种现象被称为振幅闪烁(amplitude scintillation)。闪烁并不罕见,通常发生在两极和赤道,中纬度地区被认为相对安全。但去年底的太阳超级风暴改变了这一切。美国大陆西经 80-120 度之间的大片区域出现了强振幅闪烁。如此大范围的强振幅闪烁以前从未看到过。
小红书商家账号安全告急!一个月内179.9万账号被处置,封号+注销手机号双重处罚直击生意命脉。本文拆解导流、低质内容、违规营销、商品服务四大核心违规场景,提供识别信号与防御方案,助你守住账号安全底线。 前几天小红书薯管家公布了一组数据,过去一个月累计处置违规账号179.9万个 小红书大概是账号违规管理最高压的平台了,对小红书商家而言,账号是生意的核心载体,一旦遭遇“封号 + 注销手机号”的双重处罚,不仅前期积累的粉丝、内容资产清零,还可能导致店铺关停、资金冻结,直接阻断生意增长路径。 其实这类高风险违规并非无迹可寻,大多源于对平台规则的漠视或操作边界的模糊。 本文将拆解核心违规场景、识别信号与防御方案,帮商家守住账号安全底线。 一、四大高风险违规场景直接触发“封号 + 注销”红线 1)站外导流违规:闭环生态的绝对红线 违背小红书“社区 + 交易”闭环生态核心诉求,通过各类场景诱导用户脱离平台完成交易,直接损害平台流量价值与消费者权益保障体系,是平台零容忍的一级违规行为 直接导流场景 私信 / 评论区明示联系方式:如“V信XXX”“QQ号XXXX”“电话 138XXXX”,或使用谐音(喂…
