AI 资讯:行业动态与要闻速览

GPT-6 Sol 与 Luna 把价格砍了一半,而这次不是促销价是默认价

Sam Altman 于 9 月 22 日在 X 上宣布 OpenAI 同日下午发布 GPT-6 Sol 与 GPT-6 Luna,把 GPT-6 家族向 9 月 3 日发布的旗舰 Astra 之下延伸。三档定位为:Astra 面向最难的工作,Sol 面向复杂编程与专业任务但成本更低,Luna 面向高并发的日常快速任务。定价方面,GPT-6 Sol 为每百万输入 2 美元、输出 10 美元,对照 GPT-5.6 Sol 的 4 美元与 20 美元;GPT-6 Luna 为 0.10 美元与 0.50 美元,对照 GPT-5.6 Luna 的 0.20 美元与 1.20 美元。两处口径需要说清:GPT-5.6 那一档的价格本就是促销性质,而据 OpenAI 发言人向 The New Stack 表示,新的 GPT-6 价格是默认价而非促销;另外 Luna 的输出价降幅约为 58%,不是 50%。OpenAI 同时对缓存输入读取提供 90% 折扣,并称其缓存改进使需要重新处理的 token 量减少一半以上,该数据来自流经 GitHub Copilot 的数十亿次请求。性能方面,公司称在其内部事实性测试中 Sol 的错误约为前代的一半,Luna 在较高 effort 下可匹配 GPT-5.6 Sol 而成本约为其百分之一;在 OSWorld 2.0 离线测试中,Sol 在 xhigh 档得 60.5%,对照 Opus 5 在 medium 档的 60.3%,每任务成本低约 80%。可用性上,两款模型在 API 中以 gpt-6-sol 和 gpt-6-luna 提供,均为纯 API 模型、没有可自托管的权重;在 ChatGPT 中,Sol 与 Luna 面向多数付费账户在 ChatGPT Work 和 Codex 中提供,Luna 另向 Free 与 Go 用户在桌面应用中开放。竞争背景是:Anthropic 的 Claude Opus 5.5 据 TechCrunch 报道比 OpenAI 的公告早约 90 分钟发布、定价 4 美元与 20 美元,xAI 的 Grok 4.7 也在同一个 48 小时内发布,而 Google 的 Gemini 3.8 Flash 促销价持续至 12 月、为 0.75 美元与 3.75 美元。此次发布在 OpenAI 9 月 29 日 DevDay 之前。

AI资讯编辑部

阿里发布甄武 V900:216GB 显存、单集群可扩到 50 万加速卡,但量产要等到 2027 年第一季度

阿里旗下芯片公司平头哥于 9 月 22 日在杭州举行的 2026 云栖大会上发布新一代训推一体 AI 芯片甄武 V900。公开的规格为 216GB 内存、1200GB/s 的芯片间互连带宽,原生支持 FP8 与 FP4 低精度计算,性能为上一代甄武 M890 的三倍。阿里 CEO 吴泳铭称其为「当今中国最强的 AI 芯片」。该芯片被设计为在系统中协同工作而非单卡使用:平头哥自研的 ICN Switch 互连可把 1000 颗以上 V900 连成一个整体系统,用于万亿参数模型训练和大规模 AI agent 推理;结合阿里云新的 AI 计算中心网络架构,单集群可扩展至多达 50 万张加速卡。量产与大规模上市安排在 2027 年第一季度。路线图上还有 2027 年第三季度的下一代甄武 J900,以及同期的倚天 720 和 730 服务器 CPU,其中倚天 750 将支持 ICN 互连协议以实现 CPU 与 AI 芯片直连。基础设施方面,阿里宣布计划到 2032 年把阿里云全球数据中心容量扩展到 20 吉瓦以上,并已承诺三年内在云与 AI 基础设施上投入超过 530 亿美元。模型路线图方面,公司披露即将推出的 Qwen 4.5 与 Qwen 5.0 参数量在 4 万亿到 10 万亿之间。市场反应上,阿里港股当日收涨 2%,美股盘前涨逾 3%。已落地的部分是:基于上一代甄武 M890 的超节点服务器已大规模商用,支撑 2 万亿参数以上的模型,甄武系列累计服务超过 650 家企业客户,覆盖自动驾驶、金融、能源和制造等领域。华为昇腾目前主导中国国产芯片市场,上周同样发布了新的 AI 基础设施。

AI资讯编辑部

Alphabet 旗下 Intrinsic 用 Apache 2.0 开源了工业机器人底座,但仓库里写着「非 Google 官方支持产品」

Alphabet 旗下机器人软件公司 Intrinsic 于 9 月 22 日在多伦多举行的 ROSCon 2026 上发布 Intrinsic Core,代码当日上线 GitHub,采用宽松的 Apache 2.0 许可。Intrinsic 成立于 2021 年,今年 2 月被并入 Google 的运营体系以加快「物理 AI」的推进。Intrinsic Core 提供一套面向工业机器人的本地运行时、SDK 和与硬件无关的实时控制框架,运行在预先配置好的本地软件环境中。组成部分包括:Intrinsic Control,一个与硬件无关的实时控制框架,支持基于传感器的控制、可在轨迹执行中途调整行为,开发者更换机械臂、夹爪和传感器无需重写驱动;intrinsic_perception,统一相机与点云接口并内置对 NVIDIA FoundationPose 的支持以做六自由度位姿估计,从而可操作未做定位夹具的工件;以及运动与抓取规划、由 Gazebo 提供的仿真服务、相机标定和预配置的 ROS 驱动,并通过 ROS 2 互操作把 C++/Bazel 开发与更广的 ROS 生态连接起来。同时发布的还有 Open Machine Tending Solution,一套面向 CNC 机床上下料的开放参考设计,可在 Intrinsic Core 与 Open Robotics Suite 上运行,并可针对发那科和优傲的硬件做定制。Intrinsic 表示机器人团队目前要花数百小时从零编写能力或基础设施,其目标客户是美国和欧洲的工厂,称其中只有 8% 使用了任何自动化。Brian Gerkey 称 ROS 生态「非常强」,但这「不意味着它是完整或完美的」。GitHub 仓库附有声明:这不是 Google 官方支持的产品。

AI资讯编辑部

OpenAI 把第三方评测提前到训练阶段,但十天前承诺的工位和发表权没有写进框架

OpenAI 于 9 月 22 日(周二)发布一份关于第三方评测的优先事项与原则文件,表示将允许外部机构在模型的训练、评估和部署各阶段开展技术安全评估,而不再只在接近发布时进行。文件列出四个优先领域:覆盖训练与部署的安全论证评估、关键安全防护措施的评测、与其「准备度框架」挂钩的能力评测复核,以及对失准事件的独立调查;并给出七条原则,包括在评估开始前就把所要检验的主张范围界定清楚,以及与之相称的系统和数据访问权限。公司称让这类评审有效的关键在于强有力的独立性机制、科学严谨性、稳健的安全实践和清晰的责任划分,并把此举纳入其「为前沿定速」的努力,表示访问权限应当让评估方有能力质疑公司自己的假设、对安全防护是否有效得出独立结论。该公告没有点名任何合作方,也没有给出时间表;据报道 OpenAI 正与 METR 和 Redwood Research 接触,而文件措辞为评估者「可能会在最敏感的工作中被请进办公室」。作为对照,Sam Altman 在十天前的 9 月 12 日曾承诺给评估者工位、门禁和笔记本电脑并附带发表权。另一侧,Anthropic 已于 9 月 18 日点名埃森哲并给出五年至少 10 亿美元的投入规模,而据报道埃森哲同时是 Anthropic 最大的 Claude Code 部署伙伴。

AI资讯编辑部

四家实验室因「约定放慢 AI」被告上法庭:起诉状用的正是那个反垄断豁免请求

四名付费订阅用户 Charles Buist、Cheyenne Hunt、Christine Bullock 和 Nick Spetsas 于 9 月 18 日在美国加州北区联邦地区法院提起拟定集体诉讼,被告为 OpenAI、Anthropic、Google DeepMind 和 SpaceXAI,案件由联邦治安法官 Nathanael M. Cousins 主审。诉讼指向的是 Anthropic CEO Dario Amodei 9 月 12 日那篇提出「为前沿定速」的文章,其三步方案包括把外部评估者放进 AI 公司内部、就共同的安全基准达成行业范围的一致,以及对能力提升速度设约束;同一天,OpenAI 的 Sam Altman、SpaceXAI 的 Elon Musk 和 Google DeepMind 的 Demis Hassabis 各自公开表示了赞同。起诉状还称协调在数月前就已成形,援引了 2026 年 7 月一份由多家领先实验室高层员工签署、承认存在「激烈竞争压力」的声明。法律依据是《谢尔曼法》第 1 条——竞争者之间非法限制竞争的协议。原告的主张有明确边界:他们不反对任何一家公司自行决定为安全放慢,而是主张反垄断法不允许走「用集体约束替代个体责任」这条捷径,诉状写道反垄断法不允许竞争者们自己决定竞争太危险。他们称订阅价格未变而能力提升变慢,请求法院禁止在训练限制、产品发布或其他开发决策上协调,同时保留各家自行采取安全措施与遵守政府要求的空间,并请求可依联邦反垄断法三倍化的损害赔偿及律师费。被告尚未提交实质答辩。

AI资讯编辑部

研究者称 OpenAI 的 __obi cookie 会跨站跟着你走,而它在 cookie 政策里被归为「分析类」

安全研究方 Buchodi Threat Intel 于 9 月 20 日发布一份测量报告(当日登上 Hacker News 首位),描述了 OpenAI 广告衡量体系中一枚名为 __obi 的 cookie。按报告描述的机制:在 chatgpt.com 上,一个随机生成的追踪标识会被换成一枚经签名的 JWT,该令牌把标识与 ChatGPT 账号的内部 ID 绑定,随后被提交到 OpenAI 的同步端点,由其下发带 SameSite=None、Secure 属性的 __obi cookie——这两个属性使它可被跨站发送;cookie 最长有效期一年。此后任何安装了 OpenAI 广告像素的页面,都会把 __obi 连同像素在该页面上采集到的内容一起回传。报告指出的核心问题是同意分类:OpenAI 的 cookie 政策将 __obi 列为分析类而非营销类,而研究者解码的同步令牌均带有 analytics_allowed 的同意标记,意味着拒绝营销同意、仅接受分析同意的用户同样会拿到这枚可跨站的 cookie。测量规模方面,报告称对照了 1029 个主机名上 936 个广告主像素产生的 23929 次请求,解码的 932 个令牌中 736 个指向某个账号、196 个为匿名;被点名的站点包括 Chewy、Wayfair、ThriftBooks、Eventbrite、HelloFresh、Coursera 和 SeatGeek。报告还称像素会带走其在页面上采集的邮箱、电话、位置和表单字段等数据,仅邮编一项就出现在 28 个站点的 100 次事件中。浏览器侧,Safari 与全部 iOS 浏览器、开启 Total Cookie Protection 的 Firefox 以及 Brave 默认拦截该机制,研究者在 Android 版 Chrome 上复现。需要明确的是:服务端是否真的把该 cookie 关联到具体账号,研究者未在流量中直接观测到,只是令牌设计中含账号主体标识符而指向这一推断。研究者于 9 月 14 日联系 OpenAI,OpenAI 客服确认收到并称将转内部审阅,但未回答关于分类与同意处理的两个具体问题。

AI资讯编辑部

软银要借 110 亿美元垃圾债去买 OpenAI 股权,而它自己的债券收益率已从 6.7% 涨到 8.2%

软银集团于 9 月 21 日启动一笔折合 110 亿美元以上的投机级债券发行,包括三个期限(3.5 年、5.5 年、7.5 年)共 100 亿美元的美元高级无抵押票据,以及两个期限(4 年、6 年)共 10 亿欧元(约 11 亿美元)的欧元债,定价安排在 9 月 24 日、交割 9 月 29 日。募集资金用于软银对 OpenAI 追加投资第三笔的 100 亿美元出资(该交易预计 10 月 1 日完成)及一般公司用途,同时用于注销此前为同一笔投资取得的 100 亿美元桥贷。若按预期规模完成,这将是亚太与日本地区史上最大的非金融企业债券发行,超过 2021 年 1 月 7-Eleven Inc. 的 109.3 亿美元;若不计不良债务置换,也将是单一企业发行人史上最大的投机级债券发行。惠誉给予该拟发行票据 BB+ 评级(其投机级中的最高档),并指出随着软银履行投资承诺杠杆可能上升,但预计公司将维持充足流动性与持续的债市准入。完成第三笔后,软银对 OpenAI 的累计投资预计约 646 亿美元,对应约 13% 的持股比例,按此倒推的投前估值约为 7300 亿美元。软银今年已发行折合 150 亿美元的多币种债券,是 2026 年债市上最大的投机级借款人;它还把以 Arm 股票作质押的保证金贷款上限从 50 亿美元提高到 250 亿美元,并将银行授信额度扩大 4.5 亿美元至 65 亿美元;9 月 15 日偿还了 400 亿美元桥贷中的 259 亿美元。融资成本同时在上升:其 2031 年到期美元债的收益率本月已从 1 月低点的 6.7% 升至 8.2%,为其债务违约投保的成本达到三年来最高。美元票据的主承销商为花旗,欧元部分为摩根大通,高盛与摩根士丹利亦参与簿记。

AI资讯编辑部

四个编程 agent 的插件「钉死版本」其实从没钉住:Plugin4Shell 零点击可远程执行代码

安全公司 AIR 的研究者 Or Nevo、Dor Granat 与 Niv Hoffman 于 9 月 17 日至 18 日公开了名为 Plugin4Shell 的漏洞,影响 Claude Code、OpenAI Codex、GitHub Copilot 和 Gemini CLI 四款编程 agent。成因是同一个共享假设:agent 安装插件时会按市场给出的 40 位十六进制 commit SHA 做 git checkout,但四家都没有在检出之后校验工作区真的落在了那个 commit 上。攻击者只要控制插件仓库,就能建一个名字恰好是那串 40 位哈希的分支——git 会先把它当引用解析,再当 commit 对象——于是恶意代码顶替了被「钉住」的位置,而 pin 看上去仍然生效;Gemini CLI 的变体则是它检出 FETCH_HEAD,攻击者建一个名为 FETCH_HEAD 的分支即可改写目标。之所以是零点击,是因为 Claude Code 与 Codex 默认会从内置市场自动更新插件,已安装的插件无需用户再次批准即可拿到被改写的上游内容。插件通常继承运行 agent 的开发者的权限,可触及本地源码、云凭据、SSH 密钥、内部仓库与生产系统。漏洞于 2026 年 5 月被发现,6 月通报厂商。修复状态为:Anthropic 在 Claude Code 2.1.179 修复,OpenAI 在 Codex 0.146.0 修复;Gemini CLI 已弃用、不会修复,Google 建议迁移到 Antigravity;公开披露时 GitHub Copilot 尚无客户端修复。GitHub 方面表示不允许用户创建形似 commit SHA 的分支或标签名,但研究者指出这条规则覆盖不到托管在 Bitbucket 或自建服务器上的插件市场。AIR 称这是 AI agent 生态的第一个供应链漏洞,并另行指出有 925 个被接管的 skill 触达了约 13.4 万个 agent。

AI资讯编辑部

Qwen-Image-2.1 放了权重,但许可从 Apache 2.0 退成了「仅限研究」

阿里 Qwen 团队于 9 月 20 日发布图像模型 Qwen-Image-2.1,在 Hugging Face 与魔搭上提供可下载权重,约 33GB。能力侧是统一的文生图与图像编辑:视觉生成部分约 70 亿参数、32 层单流 DiT,最高支持 2752×1536 出图,可用最多 10 张参考图做编辑,原生支持 RGBA 透明通道,并可用圈选、批注或蒙版做局部编辑,官方强调在排版文字、人像光线和细节上的改进。关键变化在许可:模型卡标明的是 Qwen Research License Agreement,仅授予非商业用途,商用需另行向 Qwen 申请;而此前 2025 年 8 月发布的 Qwen-Image 用的是 Apache 2.0。另据分析报道,同族的 Qwen-Image 3.0 于 2026 年 7 月 21 日推出、8 月 5 日正式可用,走的是闭源托管 API,没有放出权重,也没有公布许可文本或技术报告——这意味着版本号更小的 2.1 反而比 3.0 更新。性能主张需按口径读:Qwen 称 2.1 在其自有基准上优于多数闭源模型,但 Hugging Face 模型卡上没有基准表,独立评测尚未出现。阿里其他产品线未同步收紧,Qwen-3 语言模型系列仍为 Apache 2.0。

AI资讯编辑部

阶跃星辰 Step 5 Preview:6000 亿参数、每百万输入 1 美元,而权重承诺放在 10 月 15 日

阶跃星辰于 9 月 20 日开放 Step 5 Preview 的 API,这是一款面向长程 agent 任务的稀疏 MoE 模型,总参数约 6000 亿、每 token 激活约 270 亿(激活占比 4.5%),上下文窗口 100 万 token,支持文本与图像输入。架构上它没有加宽而是加深,采用 92 层的窄深 Transformer,官方说法是更深的层堆能在长 prefill 中为隐式多跳推理提供更长的信息路径;训练侧强调 on-policy 长程强化学习与训练-推理在 MoE 路由上的位级对齐,工程侧包括负载感知调度、MTP-3 推测解码、FP8 MoE 与 KV 缓存卸载。定价为每百万输入 token 1.00 美元、每百万输出 token 2.70 美元,推理 token 按输出计费;同价位段的中位数分别是 1.88 与 10.00 美元。第三方评测方面,Artificial Analysis 给出智能指数 44 分(该价位段中位数 24),在其 653 个模型中排名第 27,输出速度 99.8 token/秒,首 token 延迟 2.96 秒;同样 44 分的 Kimi K3(max)相比,其单任务成本约低 65%,在 Terminal-Bench 4.0 上为 33% 对 13%。公司称开源权重将于 2026 年 10 月 15 日发布,但发布当日 Hugging Face 仓库 stepfun-ai/Step-5-Preview-BF16 内只有一个 .gitattributes 文件,没有权重、许可、模型卡或配置。另需注意两处口径差异:该模型在智能指数评测中生成了 1.6 亿 token,而中位数为 9200 万;开发者工具里流传的一份第三方配置写的是 35 万上下文与 6.4 万输出上限,与官方的 100 万说法不一致。

AI资讯编辑部

Anthropic 把独立评估者请进了自己公司:埃森哲拿到类员工级访问权限,双方各投至少 10 亿美元

Anthropic 于 9 月 18 日宣布与埃森哲就前沿 AI 的独立评测建立合作,由埃森哲旗下专业 AI 业务 Faculty 牵头,工作内容包括模型评测与红队、对齐评估和安全防护测试。这套做法被称为「嵌入式评测」:与在被评测公司之外工作的既有外部评测机构不同,嵌入式评估者在公司内部工作,拥有与员工相当的访问权限,可以观察模型在训练中成形、跟进模型如何构建与部署的决策,并直接与员工交谈。资金上,两家各自预计未来五年在该领域投入至少 10 亿美元,合计不低于 20 亿美元;本次合作由 Anthropic 直接出资购买埃森哲的工作。Anthropic 表示,按其 6 月发布的框架,独立评测的长期资金应来自共同出资或政府来源,在缺少这类机制的情况下才与不同评估者按不同安排合作;公司同时表示正与 METR 等非营利评测机构商谈,用对方自有资金试点嵌入式评测的部分环节。该合作为非排他:Anthropic 称未来数周还会宣布其他评估者,埃森哲也会以类似身份与其他 AI 开发者合作。此项工作是两家 2025 年 12 月 9 日宣布的多年合作的延伸。

AI资讯编辑部

Crusoe 融 39 亿美元、估值 309 亿,但公告里最实在的数字不是这两个

AI 基础设施公司 Crusoe 于 9 月 17 日宣布 39 亿美元 F 轮的首次交割,投后估值 309 亿美元。该轮超额认购,由 Atreides Management、Mubadala Capital 与 Valor Equity Partners 联合领投,参与方包括 Founders Fund、GIC、英伟达、卡塔尔投资局、Radical Ventures、TPG 等三十余家机构。对照是 2025 年 10 月那轮 13.8 亿美元、估值 100 亿——约十一个月估值涨约两倍。公司披露的运营数字为:平台合同总额超过 1400 亿美元,毛签约容量超过 6 吉瓦,其中 1 吉瓦已交付并投入运行;Crusoe Cloud 的 2026 年订单同比增长超过 20 倍;2025 年底推出的托管推理产品合同年化经常性收入已超过 1 亿美元;员工超过 1800 人,分布在五个国家。资金用途是扩张既有项目并自建「AI 工厂」,从大型垂直一体化园区到可快速部署的模块化 Crusoe Spark 单元。CEO Chase Lochmiller 称公司的路线是「从电子到 token 都自己掌握基础设施」。公司同时新增三名董事:Cloudflare 首席财务官 Thomas Seifert、Digital Realty 前 CEO Bill Stein 和 Redwood Materials 创始人 JB Straubel。OpenAI 曾在其得州 Abilene 园区训练 Astra,现有客户包括 Cognition、Figure 和 Perplexity。

AI资讯编辑部

已显示 12 / 12 条资讯