今天 AI 圈有好几条值得聊的消息,我挑了几条最有意思的,一个一个说。
Anthropic 自己删了 80% 的系统提示词
Anthropic 发了篇博客,讲他们怎么给 Claude 5 这一代模型写提示词的。最炸裂的信息是:他们把自己写的 Claude Code 系统提示词删掉了超过 80%。原因很简单——新模型能力变强了,不需要那么多条条框框了。
以前你可能会写「不要加注释」「不要改这个文件」这种限制,但现在 Claude 自己就能判断该怎么做,约束太多反而碍事。他们还搞了个 claude doctor 命令,可以自动检查你的项目配置哪里需要优化,比如检测到项目是 Python 的,会自动建议用 uv 而不是 pip。
这个思路其实挺颠覆的。过去两年大家都在卷提示词工程——怎么写 prompt、怎么分步骤、怎么给 few-shot——结果 Anthropic 自己告诉你,有时候少即是多。我自己调了大半年 prompt,也明显感觉到:对 GPT-4 和 Claude 3 有效的那些长篇约束,到了 Claude 4、Claude 5 上反而影响效果。
DeepSeek 融资暂停,一份泄露的 PDF 引发关注
DeepSeek 那边出了点状况。他们本来在搞新一轮融资,但梁文锋在一次投资者交流会上的发言被泄露出去了。这事一出,DeepSeek 就暂停了融资进程。
泄露的是一份 PDF 会议纪要,内容在 GitHub 上能看得到。这事在 Hacker News 上热度飙升很快,整个技术圈都在关注。
从另一个角度看,DeepSeek V4 系列(Flash 和 Pro)的表现已经说明,即使资源有限,也不代表做不出好模型。在 LLM 基准测试排行榜上,DeepSeek V4 一直跑在前列,这确实说明了一些东西。
Cloudflare 重新定义 AI 爬虫分类:搜索、Agent、训练
Cloudflare 发了一个重要更新。之前大家只知道「AI 训练爬虫」这一种分类,管起来很费劲——你想让 AI 搜索收录你的网站,但又不想让它用你的内容训练模型,根本分不清。
现在 Cloudflare 把 AI 流量分成了三类:搜索、Agent、训练。从 9 月 15 号开始,新接入 Cloudflare 的网站,训练和 Agent 类别的爬虫默认都会被拦截。如果你的网站想被 AI 搜索收录(比如 Perplexity、Google AI Overview),可以单独放开搜索类。
这个分类比之前的粗暴一刀合理太多了。毕竟 AI 搜你的内容给你引流,和 AI 爬你的数据去训练模型,这是两码事。站长们终于有工具来区分这两个场景了。如果你是独立站运营者,这个更新值得关注——尤其是你的网站内容被 Perplexity 引用过的话。
Debian 社区在纠结要不要用 AI 代码
Debian 社区最近搞了一个投票,三个提案全是关于 LLM 怎么用在 Debian 项目里的。这是开源社区面对 AI 的一个典型样本,争议点很集中:
一派人觉得,LLM 生成的代码质量不行,而且版权有问题。毕竟训练数据里包含了一大堆 GPL 代码,生成出来的东西到底算不算 GPL 衍生作品?这个法律问题目前没有明确结论。
另一派人觉得,不用白不用,能提高效率就行。很多维护者本来就是义务工作,用 AI 写个补丁、修个文档,节省大量时间。Debian 这种老牌发行版的态度,可能会影响其他开源项目的方向——如果 Debian 说不行,那很多项目可能也会跟风限制 AI 代码。
结果还没出来,但值得持续关注。这其实也引出一个更根本的问题:开源社区到底该怎么面对 AI 生成代码?现在大家都在用 GitHub Copilot,如果哪天 Copilot 生成的代码因为版权问题被起诉,整个开源生态都会受影响。个人来说我觉得这个讨论来得晚了——AI 写代码已经渗透进了几乎所有开发者的工作流,现在再来讨论「能不能用」,弹性空间已经不大了。更好的方向可能是定一些规则,比如 AI 生成的代码必须标注来源、必须人工 review 后才能合入主线。
我的看法
今天这几条消息其实有个共同点:AI 行业正在从「能做什么」进入「该怎么管」的阶段。Anthropic 在管自己的模型能力边界,告诉用户「别写那么多提示词了」。Cloudflare 在管爬虫访问权限,给了站长分类管理工具。Debian 在管代码来源,讨论 LLM 生成代码合不合法。连最前沿的 AI 公司自己,都还在摸索「什么该管、什么不该管」。
这种变化其实挺健康的。去年大家还在一股脑往前冲——只要能跑起来就行,质量、版权、安全什么的后面再说。今年开始,行业在反思了。从 OpenAI 的语音安全事件,到 Anthropic 自己删提示词的实践,再到 Cloudflare 对爬虫的分级管理,都能感觉到行业在慢慢成熟。
对于普通用户和开发者,我的建议很简单:该用用,但别依赖。工具越来越好用,但你得有自己的判断力——不管是写 prompt、选平台、还是判断一段代码能不能用在商业项目里。同时,多关注底层基础设施的变化。Cloudflare 这次更新对小站长的潜在影响可能比很多人想象的大——如果大量网站默认拦截了 AI 爬虫,一些依赖网络公开数据的 AI 工具可能会受到影响。
今天就这些,明天继续。