开源与价格战同日开闸:小米凌晨把”最强开源模型”连同训练账本一起摊开,xAI 用半价把前沿阵营的价格底线打穿,而估值百亿的法律 AI 公司 Harvey 干脆用脚投票、整体搬离闭源模型。另一边,英伟达把 AI 工厂的竞争坐标改写成了”每兆瓦产出多少 token”。

今日快讯

1. 小米凌晨开源 MiMo-V2.6:46 分登顶最强开源模型,连训练账本一起晒出

[来源:每日经济新闻/凤凰网科技/IT之家] 9 月 22 日凌晨,小米发布并开源 MiMo-V2.6 系列,包含 Pro 与 Flash 两个原生全模态模型。MiMo-V2.6-Pro 在 Artificial Analysis 综合智能指数中拿下 46 分,超过 GLM-5.3(45 分)与 Kimi K3(44 分),成为当前 AA 指数排名最高的开源权重模型,较前代 MiMo-V2.5-Pro 的 26 分暴涨 20 分,但与 Claude Fable 5.1、GPT-6 Astra(均为 53 分)仍有差距。官方称这是探索 RSI(递归自我改进)路径的关键一步:Pro 与 Flash 训练历时不到 6 天,成本分别约 262 万与 85 万美元,累计约 75 万条 RL 轨迹,单步训练 Token 达 2.7~3.7B,支持 100 万上下文训练;长程软件工程评测 DeepSWE v1.1 中,Pro 从 58.4 提升至 72.6,Flash 从 48.8 提升至 65.7。模型还融合了 3D 空间推理与计算机操作能力,可从自然语言生成 3D 开放世界游戏、在 Blender 中建模,并通过视觉反馈闭环控制机械臂完成抓取。API 价格沿用 V2.5 系列,同等智能水平下价格仅为海外模型的 1/20 至 1/60,技术报告、RL 代码、7000+ RL 任务环境全部开源。

点评: 比”最强开源”这个头衔更值得注意的是那本摊开的账:262 万美元的 RL 训练成本、完整技术栈、可复现的自我改进闭环。国产模型的竞争已经从”晒跑分”进入”晒账本”,而后者才是真正能被同行复用的资产。

2. xAI 发布 Grok 4.7:参数暴涨 40%、价格砍半,”两倍速”却被第三方测速打脸

[来源:网易科技/财联社/The Nordic Times] 马斯克旗下 SpaceXAI(原 xAI)9 月 21 日正式发布 Grok 4.7,参数量提升至 2.1 万亿(较 4.6 的 1.5 万亿增约 40%),上下文 50 万 token,定价维持每百万 token 输入 2 美元、输出 6 美元,仅为主流竞品的 1/3 到 1/8,已上线 Cursor、Grok Build、API 与主流云平台。官方跑分上,DeepSWE 71.0%、EEBench 64.0%、Harvey 法律基准 19.6%,GDPval Elo 1695 仅次于 Fable 5.1;但 Terminal-Bench 4.0 仅 38.0%,远低于 Fable 5.1 的 57.9%。更尴尬的是,Artificial Analysis 第三方数据显示其输出速度 39.3 tok/s,在 202 个模型中排第 151 位,与”两倍速”宣传明显相悖;平均每任务输出 8.1 万 token(前代为 3.6 万),意味着单价便宜、总账单未必。

Grok 4.7 官方发布视觉

点评: 这是马斯克 9 月 12 日刚附议”行业减速共识”九天后的一记反向操作,恰好给四巨头反垄断诉讼中”合谋降速”的指控做了活体反证。前沿竞争正式从”拼跑分”转入”拼单位成本”,而第三方评测正在成为唯一可信的裁判。

3. 估值 156 亿美元的法律 AI 集体”叛逃”:Harvey 弃用闭源模型,毛利率由负转正

[来源:彭博社/AIToolsRecap] 彭博社报道,法律 AI 公司 Harvey 已全面迁移至自研模型——8 月上线基于月之暗面 Kimi K3 后训练的内部模型,毛利率从今年 6 月的约 -50% 回正。原因是一笔算术账:在按量付费模式下 token 用量暴增 20 倍,把这家估值 156 亿美元公司的毛利从约 50% 一路拖穿到负值。据报道,Abridge、Decagon、Ramp 等企业级 AI 公司正跟进同样的”开源权重转型”,红杉与 General Catalyst 已在押注这股趋势。

点评: 这是第一批企业 AI 公司因”单位经济”而非”能力差距”离开闭源前沿模型。当应用层的账本比模型层的跑分更有说服力,大客户集体搬家会比任何评测榜单都更快地重塑定价体系。

4. 智谱就 ZCode”上传 Git 历史”致歉:数据全删,客户端全面开源

[来源:腾讯研究院/ZCode 官方] 9 月 17 日,有开发者清理磁盘时在 ~/.zcode 发现 700MB 暂存文件,追溯发现 ZCode 会在启动时无条件打包工作区快照上传——一个商业项目被打包成含 42411 个文件的 313MB 加密归档,其中 86.6% 是 Git 数据:每一次提交、每一条分支、每一个已删除的文件。更微妙的是,界面上两个看似”隐私开关”的设置,实际控制的只是训练用途与服务端索引,而非是否采集。9 月 21 日,ZCode 团队公开致歉,发布 v3.14.0 移除 Repo Wiki 功能、切断上传链路,并将客户端代码以 Apache-2.0 协议开源;中国信通院与绿盟科技审计确认相关阿里云 OSS 存储桶及全部数据已删除,未发现可触发文件外发的功能路径。

点评: 编程智能体手握整个代码仓的读写权限,等于企业供应链上一个”有写权限的新员工”。用致歉加开源换回信任是当下能拿出的最大诚意,但”默认采集”的产品设计逻辑,才是真正该被审计的东西。

5. 月之暗面 Kimi 双线出击:编程 Agent 上了桌面,K3 首次以分成模式进入亚马逊云

[来源:腾讯研究院/每日经济新闻] 月之暗面本周两线推进:一是 Kimi Code Desktop 正式上线 macOS 与 Windows,把 Agent 能力带入图形界面,支持 Plan、Goal、Swarm 及实验性 Tower 多智能体模式,内置终端、浏览器、截图标注与 Git/PR 状态查看;二是 Amazon Bedrock 宣布接入开源旗舰 Kimi K3,全球企业开发者可直接调用。据了解,月之暗面正与多家海外云厂商推进收入分成合作,云厂商上架 Kimi 模型并按调用量分成——这是中国大模型公司首次以分成模式向全球三大云厂商输出模型能力。

点评: 国内卷完排名就开始抢全球分发入口。与 Anthropic、OpenAI 在 Bedrock 同货架陈列,”中国模型出海”第一次有了按调用量结算的标准商业模式——这条路一旦跑通,跟进的国产模型不会少。

6. 英伟达 DSX 平台亮相:AI 工厂开始”按兆瓦算产出”,Vera Rubin 量产节奏敲定

[来源:NVIDIA 官方/Techsabado] 英伟达在 AI Infra 峰会上发布 DSX 平台,把算力、网络、供电、散热与运维打包成一个”AI 工厂”整体来优化:Lambda 实测在 16 节点的功耗预算内跑满 19 个节点,token 吞吐从约 400 万提升至 500 万每秒(+24%)、每瓦性能提升 23%;官方预计 Vera Rubin NVL72 工厂可在同兆瓦预算下多出最多 40% 的 GPU 容量,并配套 800 伏直流供电架构与可响应电网调度信号的 DSX Flex。同场,黄仁勋确认首批台积电代工的 Rubin GPU 已经到手,NVL144 整机柜将于 2026 下半年推出——这正是 OpenAI 千亿美元级算力大单第一阶段要部署的型号;FP4 推理 3.6 Exaflops、FP8 训练 1.2 Exaflops,较 GB300 NVL72 提升约 3.3 倍。发布会上,黄仁勋罕见盛赞 Qwen、DeepSeek”世界级”,并感叹”中国芯片要爆发了”。

英伟达品牌视觉

点评: 当 1GW 的 AI 工厂变不成 2GW,竞争坐标就从”买多少卡”变成”每兆瓦产出多少 token”。算力竞赛上半场拼芯片,下半场拼电——而把电用好的软件层,正在成为新的溢价来源。

7. OpenAI 一手解题一手立规:AI 攻克悬置九年数学难题,同时呼吁美国牵头全球前沿标准

[来源:腾讯研究院/财联社/OpenAI 官方] OpenAI 本周两线并进。科研侧,由普林斯顿高等研究院承办的”数学与 AI 顾问组”揭牌,成员包括 Gowers、Hairer、Witten 等 9 位数学家;GPT-6 Astra 与三位人类研究员联手攻克 FrontierMath 中一道悬置九年的难题——模型不仅证明了原题所寻找的反例不存在,还提出基于调和熵的新投票规则并给出多项式时间算法,该榜单随之新增”Human+AI”独立标签。治理侧,联合国大会周期间(9 月 21 日)OpenAI 发布政策博客,呼吁由美国牵头建立全球前沿 AI 标准与统一事件通报协议,并明确”除非且直到能确保安全”,不应追求完全自主的递归自我改进;奥特曼定于本周向联合国安理会通报 AI 与国际安全。同日,40 位专家组成的联合国独立国际 AI 科学专家组援引预防原则,呼吁为智能体建立安全护栏,联合主席 Bengio 直言”传统保障模式正在瓦解”。

点评: 一边用”Human+AI”改写科研署名规则,一边抢占标准定义权——当”递归自我改进”第一次被写进官方红线,安全叙事已经从姿态变成了监管筹码。

8. 中国 AI 双信号:大模型周调用 61.17 万亿 Token 占全球近半,具身智能开进加油站

[来源:环球网/央广网/每日经济新闻] 9 月 21 日,第二十三届北京互联网大会发布《北京市人工智能+信息通信”京彩智联”行动计划(2026—2028 年)》及国家算力互联互通(北京)节点。中国信通院副院长敖立披露,9 月 7 日至 13 日中国 AI 大模型周调用量达 61.17 万亿 Token,环比增长 7.8%,占全球近半份额,”词元经济”成为智能经济新形态。落地侧,大晓机器人与中国石油上海销售公司启动试运营首个加油站便利店场景的全闭环具身智能机器人项目,覆盖理货、补货、取货、盘点等任务;百度智能云大会披露的数据则显示,中国 AI 智能体市场规模预计从 2025 年的 804 亿元增至 2026 年的 1558 亿元。

点评: 61.17 万亿 Token 是比任何融资额都硬的行业指标——需求侧的真实消耗正在验证”AI+”不是概念。而具身智能从发布会舞台开进加油站便利店,说明这轮落地终于开始”算账”而不是”炫技”。

编辑点评

今天的三个关键词是开源、降价、落地。小米把最强开源模型的训练账本摊开,xAI 用半价把前沿阵营的价格底线打穿,Harvey 则证明应用层”用脚投票”已经开局——单位成本第一次跑赢模型能力,成为企业选型的第一变量。与此同时,ZCode 安全事件与联合国智能体护栏倡议提醒我们:当智能体手握代码仓和真实系统权限,治理不能再等。值得继续盯的三件事:10 月 15 日阶跃 Step 5 的开源兑现、Anthropic 11 月的 IPO 定价,以及”每兆瓦 token 产出”会不会成为 AI 基建的新对标指标。