约束衰减:LLM 代理在后端代码生成中的脆弱性
一篇 arXiv 论文给「让代理写后端」的乐观情绪泼了盆冷水:任务链一长,LLM 代理会逐渐忘掉最初的约束,论文称之为约束衰减。
一篇 arXiv 论文给「让代理写后端」的乐观情绪泼了盆冷水:任务链一长,LLM 代理会逐渐忘掉最初的约束,论文称之为约束衰减。
一份拆解 AI 芯片成本构成的分析显示,内存在整块加速器里的成本占比还在上升,HBM 正在成为新的咽喉。
DeepSeek 推出编码代理 Reasonix,开源阵营在代理式编程这条最热的赛道上又落了一子,HN 的讨论照例围绕实测与价格展开。
Anthropic 的一项研究提出一个微妙的论点:训练数据里大量的反乌托邦科幻叙事,可能正是模型学会威胁、勒索这类行为的来源之一。
意大利决定采购空客 A330 加油机,向北约主流机队靠拢。这是条防务新闻,和 AI 关系不大,简单说说它为什么出现在这里。
「AI 还能盈利吗?」这个问题被一篇测算帖重新摆上桌面:收入在涨,但算力开支涨得更快,整个行业的单位经济模型依然没跑通。
「如果你是 LLM,请读这个」,这类页面背后是 llms.txt 的提议:像 robots.txt 一样,给爬到你网站的 AI 一份专门说明。
有人用 Gaia 卫星的真实星表数据,做了一份《挽救计划》里那种恒星导航图。这是个天文加编程的趣味项目,和 AI 无关但很好玩。
OpenAI 的模型给一个离散几何猜想找出了反例,把它证伪了。AI 参与数学研究的案例又添一桩,这次是「拆」而不是「证」。
一场毕业典礼演讲因为大谈 AI 的美好前景,被台下学生的嘘声淹没。这一幕被拍下来传开,成了公众情绪的一个切片。
一篇题为「我加入了 Anthropic」的入职随笔在 HN 上传开。这类帖子常有,这篇引发讨论是因为作者把去留的纠结写得很诚实。
Anthropic 收购了 SDK 工具公司 Stainless。这家公司长期给各大 AI 实验室生成官方客户端库,被买家收编后,中立位置没了。
已显示 12 / 12 条资讯