← 返回论坛
AI 日报:Meta 开源新模型、Claude Code 自动模式、英伟达 5000 亿
Meta 今天放了个新模型,叫 Muse Glimmer,是他们超级智能实验室出的第一个开源模型。30B 参数,多模态,Apache 2.0 协议,随便用,而且专门为了本地常驻的 agent 场景优化,上下文 128K 起步。说白了就是给你电脑上的 AI 助手、编程 agent 当大脑用的,Ollama 已经第一时间支持,苹果芯片的机器现在就能直接跑。扎克伯格还专门出来怼了一通搞封闭模型的同行,说 Meta 就要走开源这条路。这件事重要在哪呢,以前想在本地跑个像样的 agent 模型,要么太大跑不动,要么效果不行,现在 30B 的开源模型能稳稳待在本地,很多怕数据出公司的场景一下就有的选了。
Docker 也来凑热闹,出了个 Docker Sandboxes,专门给 AI 编程 agent 用的一次性隔离沙箱。现在大家用 Claude Code、Cursor 这些工具,最怕的就是 agent 乱跑命令把环境搞坏,或者碰到不该碰的东西。这个沙箱用完就扔,agent 在里面随便折腾,出问题也不影响本机。这条在 Hacker News 上热度冲到五百多,说明大家是真有这痛点,AI 编程火到这个份上,连怎么安全地让 agent 干活都成了独立赛道。
Anthropic 这边动作更大,宣布五天后 Claude Code 默认开启自动模式,人工审批权限那套基本要退出历史舞台。他们给的理由特别有意思:人工审批早就形同虚设,权限请求有 97% 都被直接点同意,而且人越聊越累,会话超过五十条提示之后,危险命令的拦截率从百分之十七掉到百分之五。自动模式的分类器能拦下 89% 的危险命令,比人靠谱多了。所以 Anthropic 干脆让模型自己管自己,分类器每次调用多烧的那点 token 也不跟用户收钱了。这个转变挺颠覆,等于说 AI 编程从人盯着 AI 变成了 AI 盯着 AI。
算力这边也有大新闻,英伟达和华尔街几家金融机构谈了个五千亿美元的融资协议,专门用来搞 AI 基础设施。五千亿美元什么概念,比好多国家一年的 GDP 都高。这说明 AI 这轮军备竞赛已经不光是科技公司自己的事了,华尔街的钱正式下场,数据中心、GPU 采购都得按国家基建的规格来投。
最后说个国内的,量子位报道,有研究者用 AI Agent 给顶会论文打假,拿 ICML 2026 的一百六十八篇口头报告论文做复现审计,结果九十二篇有可验证结论的论文里,只有三十四篇能复现四成以上结果,能复现八成以上的只有八篇。还有个基于 GPT-5 的论文检查系统,说顶刊论文平均每篇有四点七个客观错误,99.2% 的论文至少被标出一个问题,数学公式错误最多。当然复现不了不等于造假,很多是代码缺文件、依赖版本对不上这种问题,但 AI 把论文复现的成本打下来之后,学术界这潭水怕是要被搅一搅了。
今天就唠这些,明天见。