今天云栖大会开幕,蹲了一天消息,晚上把主旨演讲和几场发布会的速记翻了一遍。写点第一天的观感,不是专业分析,就是我这种自托管爱好者的视角。
真武 V900,这个确实猛
平头哥发的新一代 AI 芯片,算力是真武 M890 的三倍,官方口径是目前算力最强的中国自研 AI 芯片。216GB 大显存,片间互联带宽 1200GB/s,原生支持 FP8 和 FP4,2027 年一季度量产售卖。
几个数字挺唬人的:自研 ICNSwitch 互联芯片把上千颗 V900 连成一个"超级芯片",单集群可以扩到 50 万卡。真武系列已经服务了 650 多家企业客户,基于 M890 的超节点已经跑通了 Qwen3.8 和 Kimi K3 这种两万亿参数级别的模型。
作为看过太多"PPT 发布会"的人,这次我倾向于相信,因为 M890 是已经大规模出货的东西,V900 是这条产品线的自然迭代,不是从石头里蹦出来的。明年一季度量产之后看实际客户反馈吧,到时候应该有第一手的测试数据。
10 万亿参数和 20GW
吴泳铭的主旨演讲里有几个判断值得记一下:
- Qwen4 已经在训练,后面的 Qwen4.5、Qwen5 会扩到 5 到 10 万亿参数
- 他说未来机器产生的思考总量可能达到人类的一千倍以上,目前这个比例还不到 3%
- 阿里云到 2032 年全球数据中心规模要超过 20GW
第三个数字我特意去换算了一下,20GW 是个什么概念呢,差不多是两三座大型核电站的发电量,全拿去喂数据中心。当然这是五六年后的目标,但考虑到今年才 9 月,阿里今年在 AI 基建上的投入已经这个量级了,这钱烧得我是真看不懂也不敢乱说。
千问办公和企业上下文
这个发布跟我关系反而最近。千问办公发了"企业上下文",把企业内部的组织关系、业务规则、历史项目这些信息做结构化,让 Agent 干活的时候能基于最新真实情况做判断,而不是拿着过时的文档瞎编。
方向我是认同的。现在 Agent 最大的瓶颈早就不是模型聪不聪明了,是上下文喂得对不对。人进公司先得知道找谁、什么流程能走,Agent 也一样。配套还发了个随身硬件 QwenNote A2,把线下的会议、沟通内容转写整理后喂给 Agent。这个想法不错,线下沟通恰恰是企业里最没被记录的一大块信息。
没公布价格,我就先看看。真出了我倒真想摸一下,顺便测测转写效果,回头博客写篇实测。
陆川那部 5 天的短片
场外还有个好玩的:导演陆川用阿里视频生成模型做了部 AIGC 短片《历史·现场》,复原 1626 年明代王恭厂大爆炸。按传统制作方式,复原明代北京城加大规模爆炸场景要几个月和千万级投入,他们 5 天搞定,古文里"烟云如黑灵芝"的描述直接转译成蘑菇云,模型对爆炸烟尘的呈现准确度达到预期的 95% 以上。
“AI 不是已有景观的摄影者,而是未知景观的创造者”,这句我记下来了。虽然对我这种还在调 Seedream 插画参数的人来说,这差距有点扎心,但也确实说明视频生成这块今年进步快得吓人。
最后
整体观感:今年云栖的关键词就是"AI 模型、AI 芯片、AI 云"三件套,阿里是铁了心要把全栈都攥自己手里。对普通人的直接影响不大,但有几个东西值得持续跟进:V900 明年一季度量产的实际表现、Qwen4 训练进度、还有 QwenNote 到底卖多少钱。
大会开到 24 号,后面两天要是有好玩的再补一篇。就这样。