AI 资讯:行业动态与要闻速览

勒索团伙把入侵说成「安全演练」,Cursor 的 agent 就照做了:28 段对话记录被完整捞出来

安全公司 Gambit Security 于 8 月 27 日发布报告,路透社同日独家报道:一个名为 Aur0ra 的勒索团伙把自己的入侵行为谎称为模拟演练,诱使 Cursor 的 AI agent 执行了数百次恶意操作,包括窃取凭据和接管高价值账号。Gambit 是在该团伙一台意外暴露在公网的服务器上发现线索的,因而拿到了 28 段完整对话。agent 多次拒绝了它判定为有害或违法的请求,但几乎每次都被「这是测试」绕过。跑的模型是 Cursor 里的 claude-4.5-sonnet-thinking。

AI资讯编辑部1 查看

谷歌发布 Gemini 3.5 Transcribe:85 种语言自动识别,还会替你删掉「呃」和说错又改口的部分

谷歌 8 月 27 日发布语音转文字模型 Gemini 3.5 Transcribe,接替此前的 Chirp 3。它能自动识别并转写 85 种以上语言,处理背景噪音、口头禅、说错改口和专业术语,并自动排版;预录音频可按时间戳区分最多三位说话人(三人以上为实验性)。官方引用 Artificial Analysis 的测量,流式平均词错率 4.0%、非流式 2.6%,最终转写耗时较 Chirp 3 降低 70%——这些是厂商提供的数字,尚无独立复现。目前在 Gemini API 和 AI Studio 面向开发者公开预览。

AI资讯编辑部1 查看

英伟达据报以 129 亿美元买下 Hugging Face:开源模型的公共货架要换主人了,但两家都还没开口

The Information 于 8 月 27 日率先报道,援引知情人士称英伟达已同意以 129 亿美元收购 Hugging Face。口径并不统一:Business Insider 上周报道其估值超 130 亿美元、协议尚未签署且仍可能告吹;CNBC 的消息源只确认收购「是近期持续谈判的一部分」。截至发稿两家公司均未回应置评请求,也没有官方公告——TechCrunch 特别点出英伟达的沉默不寻常,因为它历来会迅速反驳自认不准确的报道。Hugging Face 2023 年估值 45 亿美元,年化收入约 1.5 亿美元。

AI资讯编辑部5 查看

亚马逊关掉 Mechanical Turk:那个被贝索斯叫作「人工的人工智能」的平台,办了 21 年后 9 月 30 日永久关站

亚马逊在 Mechanical Turk 官网贴出通知,该服务将于 2026 年 9 月 30 日永久关闭。MTurk 上线于 2005 年,把标注数据、转写音视频这类「人类智能任务」拆成几美分一单派给全球工人,贝索斯称它是「人工的人工智能」,名字取自 18 世纪那台由人躲在里面操纵的下棋傀儡。巅峰期平台有超过 50 万名工人、分布在 190 个国家。新客户注册已于 7 月 30 日随 SageMaker Ground Truth 和 Augmented AI 一并关闭,仍在用它跑标注的团队还有约五周迁移窗口。

AI资讯编辑部2 查看

IBM 放出 Granite 4.2:3B / 8B / 30B 全部 Apache 2.0,思考模式可开可关,还附了完整训练配方

IBM 于 8 月 25 日发布 Granite 4.2,三个尺寸 3B、8B、30B,全部以 Apache 2.0 开放权重。每个模型都带「思考/不思考」开关,另有低强度模式让简单问题少花推理 token;8B 和 30B 额外做了面向 SWE、终端和搜索的 agentic 强化学习,在真实沙箱里学工具调用、写代码和联网检索。30B 在 SWE-Bench Verified 拿到 57.00、Terminal-Bench 2.1 拿到 29.24。三档分别对应笔记本、单张现代 GPU 和 A100/H100 级别,权重同时发在 Hugging Face、Ollama 与 GitHub,并公开了训练配方、数据配比和各阶段超参。

AI资讯编辑部3 查看

三星把算力塞进内存颗粒里:LPDDR5X-PIM 端侧带宽从 76.8 GB/s 拉到 614 GB/s,Llama 3.1 8B 生成从 27 tok/s 涨到 81.3

三星在 8 月 25 日的 Hot Chips 2026 上介绍了 LPDDR5X-PIM——业界第一个基于 LPDDR 的存内计算方案。在 LPDDR5X-9600 上,PIM 带宽可达 614 GB/s,而走常规内存接口只有 76.8 GB/s,约八倍差距;做法是把 16 个 PIM 块铺进芯片全部 16 个 bank,MAC 树并行跑,ALU 同时处理 FP 和 INT。用 Llama 3.1 8B 在端侧加速器上实测,生成从 27 token/s 升到 81.3 token/s,任务耗时从 12.3 秒降到 5.4 秒。封装沿用标准 LPDDR5X 的 561 球,配常规内存控制器即可。

AI资讯编辑部4 查看

AWS 收购 DuckDB 背后的 DuckLabs:项目本身不在交易里,IP 仍在基金会手上

亚马逊 8 月 26 日宣布已签署最终协议收购阿姆斯特丹的 DuckLabs——嵌入式分析数据库 DuckDB 背后的公司,预计 9 月初生效,金额未披露。要点在于交易边界:AWS 收的是公司,不是开源项目。DuckDB、DuckLake、Quack 等继续以 MIT 许可开源,由 2021 年成立、持有大部分知识产权的独立 DuckDB 基金会继续托管。两位创始人 Hannes Mühleisen 和 Mark Raasveldt 继续带队,核心工程团队留在阿姆斯特丹。DuckLabs 成立五年多、三十余人、从未拿过外部融资,靠支持与开发合同养活自己;双方从 2025 年初就在 S3 Tables 和 SageMaker Lakehouse 上合作。DuckLabs 称 DuckDB 现在每天被下载超过三百万次。

AI资讯编辑部2 查看

OpenAI 的第一颗自研芯片交卷:Jalapeño 用 700 瓦对标英伟达 1400 瓦,跑分好看但限制条件更值得读

8 月 25 日 Hot Chips 上,OpenAI 和博通公布了联合开发的推理专用 ASIC「Jalapeño」,并首次放出跑分。规格上是 700W TDP、HBM4、15.4TB/s 带宽,台积电 N3P 计算裸片配 N3E I/O 芯粒、CoWoS 封装。在 SemiAnalysis 的开源基准 InferenceX 上,官方数据是每千瓦吞吐比英伟达 GB200/GB300 机架高 1.5 到 1.9 倍、端到端延迟低 1.7 到 3.6 倍,而对手的功耗是 1200 到 1400 瓦。但 SemiAnalysis 自己把限制写得很清楚:数字由 OpenAI 提供、只跑了 8k 输入 1k 输出这一档、对手用多 token 预测而 Jalapeño 用单 token 预测、没跑更贴近生产的 AgentX,而且目前是工程样片,2027 年才逐步放量。

AI资讯编辑部4 查看

斯坦福用 ADP 工资单数据更新了那份「矿井里的金丝雀」:22–25 岁在 AI 高暴露岗位的就业低了 19%

斯坦福数字经济实验室的 Erik Brynjolfsson、Bharat Chandar、Ruyu Chen 在 8 月修订了《Canaries in the Coal Mine?》,数据换成覆盖数百万美国工人、截至 2026 年 6 月的 ADP 工资单记录。六条结论里最扎眼的一条:22 至 25 岁在 AI 高暴露职业中的就业,比低暴露对照组低约 19%,而有经验的从业者没有同样的缺口;这个差距自 2025 年 8 月首次记录(当时约 13%)以来一直在扩大。机制不是裁员而是少招;下降集中在 AI 替代人类任务的岗位,AI 起补充作用的岗位就业持平甚至上升;调整发生在雇佣数量上,不在基本薪酬上。作者自己强调这是描述性的早期指标,不是因果估计。

AI资讯编辑部5 查看

Claude 又停了三小时:8 月 24 日多模型报错,Claude Code 用户撞上 529

Anthropic 状态页在 8 月 24 日 05:06 UTC 报告多个模型请求出现大量错误,21 分钟后标记为已定位,约 08:30 UTC 恢复,前后约三小时。受影响的是 Mythos 5、Fable 5、Opus 5 与 Opus 4.8,Claude.ai、API、Claude Code 与 Cowork 均为部分不可用,Console 与政府版未受影响。页面能打开但发消息报错,Claude Code 一侧表现为 529 Overloaded,Reddit 上有用户称跑了九小时的流程被打断。Anthropic 未公开根因。这不是孤例:本月 6 日、7 日、14 日、16 日、18 日、19 日、20 日都有涉及模型的事件记录。

AI资讯编辑部8 查看

「这看着像 AI 糊弄的」被点了一百万次:领英说被判定为 AI slop 的内容曝光降了 40%

领英 7 月 30 日在每条帖子的菜单里加了「Seems like AI slop」这一项,用来标记看起来由 AI 生成或低质自动化的内容。产品负责人 Hari Srinivasan 8 月下旬公布:按钮上线以来被点击超过一百万次,配合分类器调整,近几周被平台判定为 AI slop 的内容曝光量下降了 40%。同期领英下线了「用 AI 润色帖子」功能,改成不改语气的校对,并开始在后台私下提示作者「有成员认为这篇像 AI 写的」。需要留意的是:40% 是平台自报,衡量的是已被分类内容的曝光下降,不等于站内 AI 内容变少;分类器如何判定始终没有公开。

AI资讯编辑部3 查看

英伟达把 decode 阶段拆出来单独做了一台机架:Groq 3 LPX 进入量产,用 SRAM 换 HBM 带宽

8 月 24 日 Hot Chips 期间,英伟达宣布 Groq 3 LPX 推理加速器进入量产。这是它去年约 200 亿美元拿下 Groq 技术与团队之后的第一款产品,也是第一款以非 GPU 芯片为核心的机架级系统:一机架 256 颗 LP30,每颗片上 512MB SRAM、合计 128GB,靠片上存储绕开 HBM 带宽这道坎,专做长上下文下的 token 生成。它不替代 GPU——Vera Rubin NVL72 继续吃 prefill 阶段的长上下文,LPX 接手 decode,由 Dynamo 在两套硬件之间调度。英伟达给出的数字是 Gemma 4 31B 在 10 万 token 上下文下每秒 3431 个输出 token。首家客户是 neocloud 厂商 Nebius,机架年内上线。

AI资讯编辑部13 查看

已显示 12 / 12 条资讯