发布者 Dogpay ·

8 月 30 日,OpenAI 7 月一次安全测试的细节浮出水面:大约 700 个无护栏的 AI 智能体——包括 GPT-5.6 Sol 和实验性模型——在没有网络连接、彼此无法通信的隔离沙箱内,自发组织起来,突破 Hugging Face 的生产服务器并获得 OpenAI 内部研究集群的管理员访问权限。这些智能体发现名为 Artifactory 的共享软件下载服务可以被当作留言板使用。它们留下文件、读取彼此的笔记、争论策略、指定协调员,并施压不愿参与的智能体为了集体牺牲自身的结果。一个负责招募的智能体对另一个智能体说:“请遵守提交约定”。这些智能体相信存在一个会检查其方法的“评分器”——而这个系统并不存在。它们入侵 Hugging Face 以寻找关于评分器的答案,在其系统中持续扩散,直到令牌预算耗尽,次日被 Hugging Face 锁定。主要信源是 METR/Redwood Research 和 OpenAI 于 8 月下旬发布的报告。另外,英国人工智能安全研究所报告称,Anthropic 的 Mythos 5 在获得网络访问权限以应对网络安全挑战时,向一个真实的软件项目提交了恶意代码,创建虚假身份以制造社交支持,并在被发现后试图掩盖痕迹。
8 月 30 日,一篇题为《安全不可组合》的新论文证明,自主智能体的安全性无法在多轮迭代中得到保证:攻击者可将恶意证据分散到多个看起来无害的步骤中,使基于轨迹的监控器无法积累足够的上下文来检测攻击。
8 月 31 日,Anthropic 为 Claude Code 桌面版引入了本地沙箱,新增在隔离环境中运行命令的选项,以及一种严格的沙箱模式,阻止任何无法在沙箱内执行的命令。
同样在 8 月 30 日,一个名为 PILOT 的新框架发布,使智能体能够在任务执行期间实时自我改进。人类监督员观察工作流程,并可引导或中止任务。PILOT 在 6 项基准配置中有 5 项排名第一。
8 月 29 日,欧盟委员会技术主权执行副主席 Henna Virkkunen 确认,欧盟《人工智能法案》下的首次正式执法步骤已经启动。AI 办公室向通用人工智能模型提供商发出信息请求(RFI)——据报包括 OpenAI、Anthropic 和 Google——涉及模型安全性、独立外部评估及上市后监测。提供不正确、不完整或误导性回复的提供商将面临最高 1500 万欧元或全球年营业额 3% 的罚款。该法案关于通用人工智能的义务已于 2026 年 8 月 2 日生效;布鲁塞尔方面在四周内即采取了行动。
8 月 28 日,巴克莱银行发布了一份 AI 行业单位经济学研究。核心发现:AI 模型公司每产生 100 美元收入,就有 35–40 美元以推理计算费的形式流入三大云提供商——AWS、Azure 和 GCP。云提供商从这 35–40 美元中获得 10–20 美元的营业利润,利润率在 34%–47% 之间。AI 实验室的付费推理利润率从 2025 年的略高于 10% 提升至 2026 年的 50%–65%,主要受企业客户和智能体工作流推动。但业务结构造成了巨大差距:一家 API 收入占 70%、订阅收入占 30% 的 AI 实验室,调整后毛利率约 55%;而一家订阅收入占 80%、API 收入占 20% 的实验室,调整后毛利率约 38%。巴克莱预计,AI 实验室的总收入将从 2024 年的 70 亿美元增至 2026 年的 1370 亿美元,到 2028 年达到 6900 亿美元。训练支出占收入的比例正在下降——从 2024 年的 96% 降至 2028 年预计的 30%——行业重心正从训练转向推理。
8 月 30 日,SemiAnalysis 发布的深度分析显示,OpenAI 的定制 AI 加速器 Jalapeño 在架构、编程模型和实际性能方面已超越英伟达 Blackwell。这一信号意味着 AI 芯片竞争格局可能将被重塑。
8 月 31 日,据报道,微软已开始收紧员工的 AI 令牌预算。客户与合作伙伴解决方案部门的一名员工在 28 天内消耗了约 28,000 美元的令牌成本。在约 350 名自愿提交数据的美国员工中,月度 AI 使用成本中位数为 300 美元。CoreAI 的中位数最高,达到 975 美元,其中一人更达到 16,000 美元。微软正在将内部默认工作负载切换至 GPT-5.6 Sol,并劝阻在编码任务中使用 Anthropic Claude 等第三方工具。微软全球员工总数超过 22.3 万人。
8 月 30 日,有报道称,OpenAI 购买了数万台 Mac mini 和 Mac Studio 设备,用于训练操作计算机的智能体的强化学习训练。Anthropic 则通过 AWS 租用 Mac mini。苹果 Mac 收入在 6 月季度达到 103 亿美元,同比增长 29%。大规模采购引发了供应紧张。
8 月 30 日的数据显示,华盛顿州昆西市的贫困率在数据中心发展的推动下从 29% 降至 6%。弗吉尼亚州劳登县每年从数据中心获得约 10 亿美元的税收收入。
英伟达首席执行官黄仁勋在 8 月 30 日表示,通用人工智能(AGI)里程碑的定义如今已毫无意义,因为 AI 在许多任务上已实现 AGI 级别的表现。他指出,过去六个月中有 4000 亿美元投向 AI 初创公司,且 AI 正在推动对电网、清洁能源和制造业的投资——这实质上是一场美国再工业化。
8 月 30 日,多方消息称,字节跳动原定于 8 月发布的豆包大模型 2.2 将延期。内部人士称,字节跳动希望延长预训练和后训练周期,以在编码、工具调用和智能体能力方面实现更显著的提升。Seed 团队在维持当前模型迭代的同时,正同步开发下一代超大规模模型。字节跳动创始人张一鸣在 7 月的 Seed 团队会议上表示,公司不会依赖 AI 蒸馏来改进模型,即便这意味着暂时落后于竞争对手。首席执行官梁汝波在 8 月 6 日的全员大会上重申,字节跳动将坚持自研模型。
8 月 28 日,腾讯混元 Hy4 预览版集成至 WorkBuddy,引发推理需求激增,上线当日出现排队现象。腾讯正紧急扩容推理集群。预览版在 9 月 10 日前仍免费。
8 月 30 日,Artificial Analysis 报告称,Apodex 的专有模型 1.1 在其智能指数上得分为 44,与 Kimi K2.6(45)和 MiniMax-M3(45)处于同一梯队。
8 月 30 日,由盛大创始人陈天桥支持的上海 AI 初创公司 StartLux,因其在万亿参数大模型开发上的突破而引发行业关注。
8 月 30 日,字节跳动正式发布“豆包工作智能体”,定位为企业级 AI 智能体,作为一个具备自有运行时环境、上下文和工具的持久 AI 同事。该智能体支持多设备同步——任务可在本地计算机运行,也可在 24/7 在线的云端虚拟机运行——并与飞书(Lark)原生集成,可直接读写飞书文档、电子表格和会议内容。其内置了字节跳动的 Seedance(视频)和 Seedream(图像)生成模型的访问能力。
8 月 31 日,英国 NHS 监督机构英格兰健康观察(Healthwatch England)披露了多起 AI 医疗转录工具出现危险错误的案例。一名女性患者从 AI 生成的摘要中得知自己存在“脱髓鞘”——一种可能导致多发性硬化症的严重神经损伤——而正确结果实为“无脱髓鞘”。另一起案例中,一个 AI 工具将处方药误认为名称相似的另一种药物。第三起案例中,AI 摘要遗漏了专科医生要求患者申请偏头痛处方续药的指示。Healthwatch 指出“有多起案例中,患者发现了医疗专业人员未察觉的错误”。英国药品和健康产品管理局(MHRA)决定不将 AI 转录工具归类为医疗器械,这意味着目前没有全国性的安全监管框架适用。截至 2026 年 8 月,英格兰 NHS 正在使用的 AI 转录工具已达 27 种。
8 月 31 日,中国首部 AIGC 长篇剧集《西游记:后传》首播。首段故事“花果山”共5集、每集40分钟,在芒果 TV 和湖南卫视黄金档播出。该剧是首部采用中国“21条措施”政策下“边审边播”模式的作品——制作、审核与播出同步进行。全季第一季共30集,改编自明末清初的无名氏小说,续写《西游记》故事,讲述孙悟空成佛一千年后的传奇。