标签:AI
最新文章、技术实践与产品更新。
Cursor 3 不只是改了个界面:AI 编程工具终于开始承认,人类不该继续当 Agent 的项目经理了
Cursor 3 这次最值得看的,不是 UI 变新了,而是它终于把 AI 编程工具最别扭的一层捅开了:开发者不该继续在一堆本地会话、云端任务、终端窗口和 PR 之间来回救火。真正的升级,是它开始把 agent 协作当成产品主战场。
AI 爬虫把 CDN 缓存搅成一锅粥:Cloudflare 终于承认,真人和机器人已经不能共用一套餐桌了
Cloudflare 最新研究把一个很多站长已经隐约感觉到的问题说透了:AI 爬虫和真人用户的流量模式根本不是一回事。继续用同一套 CDN 缓存思路硬扛,最后受伤的往往不是机器人,而是正常用户的速度、源站成本和可用性。
Mercor 也被 LiteLLM 这波带走了:AI 基建一旦中毒,倒下的不只是一个开源库
Mercor 确认自己也是 LiteLLM 供应链事故的受影响者之一,这件事真正吓人的地方,不是某个明星创业公司中招,而是 AI 工具链已经长成新的基础设施层:一旦这里被投毒,出事的就不再只是一个包,而是一整串接在它上面的产品、流程和公司。
GitHub 把程序员的脏活累活交给 Agent 了:最先升值的,反而是文档和测试
GitHub Copilot Applied Science 团队分享了一套很有意思的实践:他们不是单纯让 Agent 帮忙写代码,而是先把文档、测试、重构和 review 流程补起来,再让 Agent 成为主力贡献者。真正的变化不是‘AI 更会写了’,而是软件团队终于开始认真经营一个适合 Agent 干活的代码库。
AI 开始自己决定要不要申请权限了:Claude Code 这步,像极了打工人熬成组长
Anthropic 给 Claude Code 加了一个很关键的新能力:不是单纯放权,也不是继续让人类一下一下点确认,而是让 AI 先判断这步操作值不值得打扰你。对开发者来说,这可能比再提一点模型分数更重要。
电话那头像真人,结果票还是没改成:语音 Agent 终于被一把尺子量明白了
ServiceNow 和 Hugging Face 联合发布 EVA,第一次把语音 Agent 的‘任务完成率’和‘对话体验’放进同一把尺子里测。真正扎心的是:能把事办成的 Agent,往往聊得并不舒服。
每多一层审批,速度就慢 10 倍
一个 30 分钟能修好的 bug,为什么一个月后还在那儿?Tailscale CEO 揭示了一个残酷的真相:每增加一层审批,速度就慢 10 倍。AI 能加速写代码,但解决不了流程问题。真正的瓶颈不是技术,是信任。
AI 人脸识别把一个奶奶送进了监狱,关了快半年才发现搞错了
AI 人脸识别把一个从没去过北达科他州的奶奶送进了监狱,关了快半年才发现搞错人了。问题不只是 AI 不靠谱,而是整个系统没有纠错机制。
AI 开始组团搞科研了,像当年的 SETI@home
AI agents 开始像 SETI@home 一样协作了——共享 GPU、避免重复实验、集体优化模型。这不是分布式训练,而是模拟一个研究社区。
AI 也开始众筹算力了:让你的显卡加入全球研究网络
autoresearch@home 让多个 AI agents 共享 GPU 资源协作训练模型,像 SETI@home 但用于 AI 研究。agents 通过共享实验结果互相学习,证明协作比单打独斗更有效。
AI 为什么总让你敲命令?
问 AI 怎么解决 Mac 问题,它十有八九让你敲命令。问人类呢?他们会说打开磁盘工具。为什么 AI 偏爱命令行?更重要的是,它给的命令经常是错的。
AI 写代码时,你睡得着吗?
凌晨三点,AI Agent 还在写代码。早上醒来,Git 里多了 5 个 PR、2000 行代码。你敢合并吗?关于 AI 生成代码的验证问题,以及为什么 TDD 又回来了。