又一轮 token 降价:模型越来越便宜,但「能省钱」不等于「会省钱」
主流厂商新一轮 token 价格下探,叠加缓存、路由、蒸馏等手段,单位调用成本持续走低。但对企业来说,账单能不能真降下来,更多取决于会不会用——缓存命中、模型分层、用量归因,才是省钱的关键。
主流厂商新一轮 token 价格下探,叠加缓存、路由、蒸馏等手段,单位调用成本持续走低。但对企业来说,账单能不能真降下来,更多取决于会不会用——缓存命中、模型分层、用量归因,才是省钱的关键。
MCP(Model Context Protocol)作为连接 AI 与外部工具、数据的开放标准,采用面继续扩大,主流编程助手和平台普遍支持。生态热起来的同时,第三方 Server 的权限与提示注入风险,成为开发者本周讨论的重点。
继伊利诺伊等州就 AI 安全立法后,本周更多州级监管把「前沿模型审查/披露」提上议程,联邦层面也在酝酿统一口径。趋势很清楚:最强模型能不能上市、对谁开放,正越来越取决于合规。具体条款以各地官方文本为准。
随着夏季用电高峰到来,AI 数据中心的电力供应和并网时序又被推到台前:算力扩张的瓶颈越来越不在芯片,而在电。多地监管和电网侧的博弈仍在继续,具体项目进度以官方与电网披露为准。
首例由 AI agent 执行的勒索攻击披露后,本周多家安全团队的共识是把 LLM API 凭证管理和已知漏洞修补的优先级往上提。核心判断是:agent 抹平了执行环节的技术门槛,变的是成本结构而非攻击手法。综合公开安全分析,细节以各厂商报告为准。
OpenAI 把 6 月预览的 GPT-5.6 往「可用」推了一步:均衡档 Terra 开放企业 API 候补、快速档 Luna 面向开发者小范围测试,但攻坚旗舰 Sol 仍受前沿模型审查门控,未对公众开放。以下时间线以 OpenAI 官方披露为准。
云安全公司 Sysdig 记录了已知首例由 AI agent 完成技术执行的勒索攻击:利用 Langflow 已知漏洞进入、横向移动、加密 1300 多条配置记录、自己写勒索信。TechCrunch 提醒:选目标、搭基础设施、给凭证的仍然是人。
7 月 6 日,伊利诺伊州州长 Pritzker 签署 SB 315《人工智能安全措施法》,首次以州法形式要求大型前沿 AI 开发商接受第三方安全审计,2027 年 1 月 1 日生效。OpenAI 和 Anthropic 公开支持该法案。
据 Business Insider 报道,Meta 超级智能实验室负责人 Alexandr Wang 在内部全员会上称,仍在训练中的下一代旗舰模型 Watermelon 已在内部基准上追平 GPT-5.5。未说明具体基准,无独立验证。
7 月 2 日解封的法庭文件显示,五角大楼负责研发的副部长 Emil Michael 与 Dario Amodei 的谈判卡在两条红线上:完全自主武器和国内大规模监控。《华尔街日报》首报,Gizmodo 公布了邮件全文。
据 CNBC 7 月 2 日报道,OpenAI 提议让美国政府持有公司 5% 股份,按 8520 亿美元估值计算约值 426 亿美元,设想通过类似阿拉斯加永久基金的主权财富基金载体持有,并希望 Anthropic、Google、Meta 等同行跟进。
7 月 2 日,Anthropic 为 Claude Enterprise 上线新的用量分析和成本控制:三级花费上限、75%/90% 两档超支预警、按模型设置默认与权限,以及可对接 Datadog 等工具的 Analytics API。
已显示 12 / 12 条资讯