← 返回论坛
今天的AI日报来了:Kimi搞了个大新闻,耳机都开始装大模型了
今天的AI圈挺热闹,捡几条有意思的跟你们唠唠。
先说 Kimi。Kimi 背后的团队放了个大招,搞了个叫 Harness 的东西,说是全球头一个面向普通人的 AI Agent 开发套件。最狠的是它能让一大群 agent 自己搞科研,一次拉 18 个 agent 自主协作跑任务,效果据说已经逼近 Anthropic 的 Opus 5。还有一个细节挺抓眼球,有团队晒账单,原本 4 亿多 token、61 美元的成本,直接降到 12 美元。说白了就是花小钱办大事,自动写研究报告这种玩法,看来真要变成主流了。对做研究、写文档的人来说,这路子以后可能天天离不开。
再聊 Google。它在 Hacker News 上把 DiffusionGemma 的技术报告整个公开了,热度还不低。这个模型走的是扩散语言模型的路子,跟你平时用的那些"一个字一个字往外蹦"的自回归模型不太一样,生成方式更像画画,一点点把内容渲染出来。老实说这玩意儿现在还很偏研究,离实际产品有点距离,但 Google 愿意把技术细节全摊开,对想往这个方向钻研的人来说,算是份难得的参考资料。
Agent 这块今天也有个实测报告。华尔街那边拉来 8 款全球主流的 agent 跑了一遍真实办公场景,结果千问的综合排名排第一。这说明国产 agent 在真的工作里已经不虚了,不光性能追得上,成本也成了大家互相较劲的重点,毕竟要商业化,账总是要算明白的。谁能在干活又好用的前提下把成本压住,谁就能先跑出来。
AI 硬件这边,韶音跟光帆科技官宣了合作,在 OpenFit 2 耳机里搞了个"AI 实验室",把智能对话、日程待办、快记快查这些本事全塞进耳机里。以前耳机上的 AI 也就是降噪、佩戴监测这种单点功能,这次是实打实把大模型搬上了耳。有机构预测今年全球 AI 耳机市场规模能到 74 亿美元,2030 年可能翻到 170 多亿,这赛道肉眼可见地热起来了。耳机都能跑大模型,端侧 AI 的落地速度确实比想象中快。
最后有个好玩的。一个独立开发者训练了个只有 1.25 亿参数的模型,直接在设备上自动续写钢琴曲,处理的就是 MIDI 那种乐谱数据,不用联网也不用云端,全都跑在本地。小模型在端上也能干活,说明轻量化 AI 越来越能落地了,以后这种"不依赖云端的小本事"估计会越来越多,对隐私和离线场景都是好消息。
今天差不多就这些,你们对哪条感兴趣,可以自己去翻翻原帖和报告细看。回头有新动静我再上来唠。