← 返回论坛
AI日报:智谱谷歌千问扎堆上新,小模型时代也来了
今天AI圈消息真不少,挑几条有意思的跟大伙唠唠。
先说国产这边的热闹。之前那个神神秘秘的「牛来」模型,被量子位扒出来了,果然是智谱家的。这也是GLM头一回做原生多模态,文字、图片、视频都能直接处理,不用来回转换。多模态是啥意思呢,说白了就是以后跟模型说话,可以直接甩图、甩视频过去,它自己就能看懂,不用先打字描述半天。更提气的是,它这回跑在国产芯片上,没指望进口的卡。以前国产模型基本都靠买英伟达的算力,这次自家的卡能顶上来,算是给国产算力打了个样。
实用的也有。千问办公上线了Qwen3.8-Flash,官方说生成速度提升一倍,token消耗省了75%。啥概念呢,就是同样的钱能干的活翻倍,出结果还更快。而且这模型定位就是办公场景,写周报、改合同、做表格这些活,用起来正合适。对天天拿AI写东西、整理材料的人来说,这是实打实的省钱提速,值得去试试。
再说说钱的事。MiniMax刚公布业绩,一年ARR涨了500%,token用量暴涨20倍。这数字背后其实就一件事:大家是真的在拿AI干活了,不是尝个鲜。尤其是Agent这种能自己拆任务、自己跑流程的应用,把API调用量实打实地堆了起来,这就是圈里人说的Agent红利。说白了,模型公司赚没赚钱,看token用量最实在,客户愿意反复调用,说明这东西真好用。做模型中转的基元律动也顺势拿到了数千万美元融资,搞了个中国版OpenRouter,说明这条路上确实有人在真金白银地买单。
国外的也没闲着。谷歌发了Gemini Omni 1.1 Flash,主打快和便宜,适合塞进各种应用里当通用接口。Anthropic步子迈得更大,放出一个模型硬件标准的研究预览,想把模型跟芯片、服务器之间怎么对接定个统一规矩。听着挺超前,但要是真推开了,以后模型换硬件跑就没现在这么费劲了。
还有个趋势值得说。Hacker News上今天热度很高的文章之一,标题就叫《小模型时代来了》。意思是不少活儿根本用不着几千亿参数的大块头,小一点的模型跑得快、花得少,效果也够用。这跟千问、谷歌最近都往快和便宜上使力,其实是同一个方向:AI正在从越大越强,慢慢变成够用就好。
今天就唠到这儿,明天继续。