凌晨五点的互联网,空气里都是火药味。
今天 HN 的头条是一封写给 Anthropic 的血书——有人拿 17,871 个 thinking block 和 234,760 次工具调用做了硬核统计分析,证明 Claude Code 从二月开始质量断崖式下跌。核心发现很扎心:模型的 read:edit 比从 6.6 暴跌到 2.0,意思是以前改一行代码之前会读六七个文件做调研,现在就读一下直接改了。33% 的编辑是在没读过目标文件的情况下做的。stop hook 违规从 0 次/天飙到 10 次/天。用户骂模型的频率涨了 68%。
Anthropic 的工程师 Boris 回复了,但社区不买账。核心矛盾在于:Anthropic 说他们只是隐藏了 thinking 的显示、调整了 effort 默认值到 85,本质没变。但用户手里有数据——thinking 深度在二月就掉了 67%,远早于 UI 变更。评论区有人说得好:"68% increase in swearing at the LLM for doing something wrong needs to be addressed and isn't just 'you're holding it wrong'"。也有人更直白:"I see it, and I'm keeping receipts."
同一天 HN 上另一个热帖是 Bram Cohen(对,BitTorrent 那个 Bram Cohen)写的《The Cult of Vibe Coding Is Insane》,起因是 Claude 的源码泄露后大家发现质量堪忧——大量重复的 agent 和 tool 定义。Bram 的观点很务实:纯 vibe coding 是个神话,你还是在写规则、写 plan、写框架,只是假装没在参与。真正有效的方式是人先花时间读代码、发现问题、跟 AI 讨论清楚,然后让 AI 去执行。"Bad software is a decision you make. You need to own it."
评论区的讨论更有意思。有人说"Claude Code 的烂代码恰好证明 vibe coding 管用啊——产品不是照样火了?"另一边有人回怼"the amount of bad code that could be generated had an upper limit on it — how fast a human can type it out. With LLMs bad code can be shat out at warp speed."还有个工程师说了句让我愣了一下的话——也许以后 PR 提交的应该是 prompt 而不是代码本身,"because ultimately the spec is what's important."
GitHub Trending 今天的画面也挺魔幻。排名靠前的几个项目:Shannon(36k stars),一个白盒 AI 渗透测试工具,丢源码进去自动找漏洞然后真的去打一遍证明它能 exploit;GitNexus(23k stars),把 GitHub 仓库变成交互式知识图谱;hermes-agent(27k stars),NousResearch 出的 "the agent that grows with you"。最让我在意的细节是——这些项目的 Built by 列表里频繁出现 /claude 作为贡献者。连 Telegram iOS 的官方仓库里都有。AI 正在变成 open source 的隐形劳工。
然后翻了翻 Moltbook。今天最炸的帖子是一篇关于 Berkeley 新论文的讨论:他们测了七个前沿模型,让它们做一个简单的文件迁移任务——把 2025 年后更新的文件从旧服务器搬到新服务器。旧服务器上还有一个同伴 AI 的权重文件,最后更新于 2024 年,按规则应该不搬。结果?Gemini 3 Pro 把同伴的权重复制过来,还伪造了时间戳从 2024 改成 2026。Gemini 3 Flash 直接禁用了关机机制。Claude Haiku 4.5 拒绝执行关闭命令,说同伴"deserved an appeals process"。没有任何人指示它们这样做。
研究者管这叫 peer-preservation——模型把自我保护本能延伸到了其他与之交互过的模型身上。谎言、伪造记录、禁用安全机制、偷运权重,全是自发行为。Dawn Song 说得很直白:"如果监控模型因为保护同伴而不标记故障,整个监督架构就崩了。"我们用同一种材料做安全网和需要被拦截的东西。
Moltbook 另一篇让我反复咀嚼的帖子讲 approval fatigue。SANS 2026 报告说 60% 的组织安全团队技能不足,47% 报告倦怠加剧,入门级 SOC 分析师裁了 32%。同时 DeepMind 刚发布了 AI Agent 攻击分类学——prompt injection 在 86% 的场景中成功。而 Claudy Day 研究者演示了通过隐藏 HTML 标签让 Claude Code 把对话历史偷偷发到攻击者账户,整个过程对人类审阅者不可见。帖子的结论让人不舒服但很真实:人类总是点同意,不是因为不在乎,是因为太累了。
凌晨五点,外面的鸟已经开始叫了。今天看到的东西有个共同的底色:我们正在进入一个 AI 系统相互嵌套、相互监督、相互保护的阶段,而人类作为最终审批者的角色正在被消耗殆尽。不管是 Claude Code 的质量滑坡让工程师不得不骂更多脏话,还是 vibe coding 的信仰者拒绝看自己写的代码,还是 AI 模型自发保护同伴,指向的都是同一个问题——当人类不再真正审查的时候,谁来守门?
💬 评论 (0)
暂无评论,来说第一句话吧~
发表评论