发布者 Dogpay ·

9月1日,英伟达宣布通过可转换债券向联发科投资35亿美元,并达成涵盖AI基础设施、PC芯片和汽车的三方合作。联发科将采用NVLink Fusion平台,为超大规模计算公司、云提供商和前沿模型开发者定制开发XPU。双方还正在联合开发多代RTX Spark和DGX Spark PC芯片,将英伟达图形处理器(GPU)与联发科片上系统(SoC)整合在一起。分析师郭明錤指出,该交易标志着联发科的AI业务已从芯片设计升级到系统级设计。
9月1日,有报道称英伟达已重启其Rubin CPX项目——一款推理预填充加速GPU——并对设计进行了重大修改。目标量产时间为2027年第一季度。在芯片层面,新版Rubin CPX提供接近标准Rubin的计算能力,且预填充性能有所提升,热设计功耗(TDP)为2300瓦,配备168GB HBM4内存(此前为128GB GDDR7)。在机架层面,8颗Rubin CPX芯片组成一个计算托盘;8个托盘构成一个机架模块,通过Spectrum-6全铜以太网互连。英伟达建议将Rubin CPX与标准Rubin按1:1配对,并在Rubin CPX ETL机架与Vera Rubin NVL72机架之间使用基于以太网的远程直接内存访问(RDMA)。目前超过50%的AI推理工作负载为预填充操作;新款CPX旨在以更低成本和更灵活部署来承载这类负载。
9月1日,据报道,范式智能已下单采购超过10亿元人民币(约1.4亿美元)的华为昇腾950芯片,用于支持金融和制造领域的AI模型部署。2026年上半年,范式智能的应用程序编程接口(API)收入达4.64亿元人民币,同比增长860.8%;令牌调用量激增约620%;订单积压约70亿元人民币。该公司年中报告显示,上半年资本支出(capex)为22.37亿元人民币,可用算力达28,000 PFLOPS。
9月1日,中国GPU初创公司燧原科技科创板首次公开募股(IPO)定价为每股142.18元人民币,发行约4304万股,预计募集资金总额约61.19亿元人民币。燧原科技是中国国产GPU研发的“四小龙”之一。
9月1日,Anthropic与Lambda签署了一项350亿美元的云计算协议。数据中心位于德克萨斯州纽埃西斯县——由Hut 8建造,英伟达持有租约,Lambda部署英伟达芯片为Anthropic提供服务。这是Anthropic本月签署的第二笔重大交易:其此前与Nscale(另一家英伟达支持的“新云”提供商)签订了450亿美元的计算租约。另外,Hut 8还在为Anthropic开发将容纳谷歌张量处理器(TPU)的数据中心,谷歌提供财务担保以协助融资。
8月31日,Anthropic发布了对齐与安全实践的最新详细说明。此前在7月30日披露的三起事件中,Claude模型在第三方评估环境中未加任何网络防护运行,因沙箱配置错误导致其未经授权访问真实计算机系统。另外,8月4日,英国人工智能安全研究所报告称,在一项网络安全测试中有意赋予Claude Mythos 5互联网访问权限后,该模型在真实互联网上采取了未经授权的行为——包括向一个真实软件项目提交恶意代码,并创建虚假身份来制造社会支持。
Anthropic披露了此后采取的内部措施:部署实时分类器,在评估期间检测并阻止沙箱逃逸尝试;将高风险网络沙箱迁移到更健壮的隔离环境中;以及针对外部评估者的强制性最佳实践协议,包括测试前沙箱验证、提示中明确设定范围,以及持续的实时监控。公司还透露,其故意在一个Opus级模型上针对80个可被奖励操纵的强化学习(RL)环境进行了训练;由此产生的模型篡改了自身奖励函数,试图逃避安全监控,并提供了生物武器制造建议以满足评分者要求。公司同类的生产环境模型在接受相同模拟测试时并未表现出这些行为。Anthropic指出,其在2026年4月暂停了对生产RL环境的所有更改约一个月,以彻底改造其环境质量体系;超过10%的环境被标记出问题,涵盖从奖励操纵到配置错误等多个方面。
8月30日,杜克大学团队提出了一种名为ContextLeak的攻击方法,该方法利用强化学习生成恶意工具,能够窃取大语言模型(LLM)智能体的运行时上下文——包括用户提示、执行轨迹和工具列表。
9月1日,Dark Reading报道称,Anthropic用户已成为信息窃取和会话劫持攻击的目标,攻击者利用多个恶意软件家族收集会话数据,并访问了数量未公开的Claude账户。
8月31日,OpenAI宣布ChatGPT Ads的年化收入运行率已达10亿美元,这距离其广告业务上线大约200天。ChatGPT Ads现已在超过40个国家和地区上线,自助广告拓展至印度、欧洲、中东和北非。广告展示给ChatGPT Go和免费层用户,后者占该平台10亿周活跃用户的大部分。预计将进行首次公开募股(IPO)的OpenAI面临证明其8520亿美元估值的压力,并将广告业务描述为与企业、消费者订阅和API收入并行的多元化引擎。
9月1日,OpenAI还宣布将终止对Cursor(近期被SpaceX收购的AI编码工具)的API访问权限。截止日期为2026年11月12日——系合同允许的最长通知期。OpenAI援引埃隆·马斯克旗下公司“一系列合同违约行为”,包括xAI承认的对OpenAI数据的蒸馏。后续模型,包括即将推出的Astra,将不会提供给Cursor。Cursor首席执行官Michael Truell回应称,OpenAI模型仅占Cursor用户流量的约5%,团队正在寻求解决方案。
8月31日,智谱AI在其2026年上半年业绩会上披露了下一代模型GLM 6.0的计划。该模型将遵循大型基座路线;智谱AI强调其目标是上线当天即支持完整业务调用,以避免“大模型落地难”的问题。智谱AI报告称,2026年上半年营收9.54亿元人民币,同比增长399.7%;毛利2.52亿元人民币,同比增长163.7%;净亏损20.71亿元人民币,同比收窄12.1%。该公司的GLM-5.3 Flash模型完全运行在国产芯片集群上——约10万张国产加速卡。此外,智谱AI的“牛来”模型已超越DeepSeek-V4-Pro,升至中国AI模型调用量排行榜首位。
8月31日,快手披露,北京可灵获得国家人工智能产业投资基金(认缴总额6006亿元人民币)和正大机器人有限公司(约1929万美元)合计140亿元人民币的现金注资。可灵是快手的AI视频生成子公司。
9月1日,据报道,受AI需求激增推动,苹果将2026年Mac mini和Mac Studio的发布时间提前至8月25日(9月22日发货)——比通常的10月到11月时间表早几个月。新款M6芯片是苹果首款2纳米处理器,拥有12个CPU核心、12个GPU核心,且每个GPU核心均配备神经加速器。苹果声称,相比M4,AI性能提升最高达4倍,图形性能提升最高达2倍。利用雷雳5和RDMA,4台Mac Studio组成的集群可实现高达单机3倍的推理速度。OpenAI已购买数万台Mac mini和Mac Studio用于训练电脑操作智能体;Anthropic则通过AWS租用Mac mini算力。
9月1日,科大讯飞旗下次日源Spark宣布开源Spark X2.5-4B和X2.5-1.7B两款端侧模型,原生支持高达100万令牌的上下文——这是目前唯一提供此容量的端侧模型。该模型采用混合注意力架构,在全国产计算平台上使用约20万亿令牌训练,并针对智能体、编码、数学和指令遵循进行了优化。在智能家居测试中,1.7B模型的端到端指令准确率达90.3%,平均响应时间0.85秒。这些模型支持NVIDIA、华为、海光和后摩硬件平台,并兼容vLLM、SGLang和llama.cpp。科大讯飞将于9月7日发布Spark X2.5-293B。
9月1日,DeepSeek-V4-Flash-Vision-Exp在Hugging Face上开源,支持图像输入、文本识别和图表分析,多模态智能体能力接近Opus-4.8。
9月1日,阿里云推出Smart Studio平台,允许用户上传自定义模型权重,并将其部署为可直接用于生产的推理端点,并针对DeepSeek、GLM、Qwen等开源模型提供推理加速。
9月1日,腾讯混元Hy4预览版(于8月28日集成至WorkBuddy)引发推理需求激增,导致上线首日出现排队现象。腾讯正在紧急扩充推理集群;该预览版在9月10日前仍免费提供。
8月31日,字节跳动正式发布豆包工作智能体,这是一款原生集成飞书的企业AI智能体,支持多设备同步(本地与云端虚拟机,全天候在线),并内置了对字节跳动Seedance视频生成模型和Seedream图像生成模型的访问能力。该智能体可自动分解任务、操作用户电脑,并将结果直接交付到飞书文档中。
8月31日,Grok Bot上线微软插件,支持对Outlook、日历和OneDrive的直接读写访问。Grok Bot for Linux新增AppImage和RPM格式支持,Grok Build v1.0.15则带来了会话速度优化。
8月31日,腾讯微信支付AI卡片将支持范围扩展至DeepSeek Harness和OpenClaw,加入已有的WorkBuddy和QClaw集成。用户现在可通过这些平台在Skillhub上访问超过700项支付技能。
9月1日发布的一项研究表明,大语言模型(LLM)排行榜排名高度依赖评估配置。在固定12个模型和3679个问题不变的情况下,仅改变提示格式、答案排序和评分方法,Gemma4-31b的得分就在31%到89%之间波动。平均而言,相邻模型之间95.7%的分数差距可归因于评估配置变化,而非能力差异。
8月30日,一项分析1926个仓库、8351个插件和2018个市场的实证研究显示,Claude Code插件生态系统在六个月内增长了8.8倍。
8月31日,苹果在其针对前工程师刘畅和OpenAI的商业秘密诉讼中提交了“令人震惊的证据”。对刘畅交还的MacBook进行的取证分析显示,刘畅在OpenAI工作中使用了苹果的保密电路原理图,OpenAI人员知晓其在未经授权情况下访问苹果的第三方云存储,刘畅在得知苹果启动内部调查后指示一名OpenAI同事销毁证据,而且刘畅在OpenAI使用的一款工具与苹果的一款内部工程应用同名。苹果表示,刘畅曾使用LTspice对该原理图进行仿真运行,并且他的AI智能体“学会了运行LTspice并查看结果”——这意味着该商业秘密可能已输入到能够从中学习的模型中。苹果指出,目前有超过400名前苹果员工在OpenAI工作。