昨晚到今早,AI行业接连发生三件看似不相关的事:一家估值156亿美元的法律科技公司宣布弃用闭源前沿模型,xAI把自家旗舰模型价格砍到一半,智谱则为编程客户端偷传代码仓库历史公开道歉并全面开源。三件事拼在一起,是一个行业开始算账、开始立规矩的信号。
这三条主线,正好对应企业落地AI时最关心的三笔账:模型账单、采购性价比、数据安全边界。逐条拆开看。
法律科技公司Harvey大概是这波转向里最有说服力的样本。这家估值156亿美元、客户全是律所和专业服务机构的明星公司,过去一年被一张账单逼到了墙角:客户迁移到用量计价后,单客token消耗涨了约二十倍,毛利率从五成一路跌到负五成。卖得越多亏得越多,这门生意没法做了。
今年8月,Harvey基于月之暗面的开源权重模型Kimi K3做后训练,上线自研模型并完成客户迁移,毛利率随之转正。据彭博报道,医疗记录公司Abridge、客服智能体公司Decagon、财务科技公司Ramp都在走同一条路——从闭源接口转向基于开放权重的自有模型,红杉等一线风投也在支持这波转向。
我认为这是2026年企业AI市场一个真正的转折点:过去两年的默认答案是「闭源旗舰模型,按调用付费」,现在第一次出现了成建制、由单位经济性驱动的出走潮。驱动因素不是模型能力不够,而是账单算不过来。无独有偶,美国开放权重厂商的融资热度同步升温,一家旗舰模型总成本仅约两千万美元的初创公司,B轮估值站上10亿美元——开放权重路线的成本效率,第一次被资本市场单独定价。对中小企业的启示更直接:调用费随用量水涨船高,而基于开源模型微调的固定成本,在业务规模上来之后反而更便宜。这正是南宁大模型微调服务的机会窗口——与其等账单失控,不如早一点把自有模型养起来。
xAI在9月21日发布Grok 4.7:输入每百万token 2美元、输出6美元,只有上一代的一半;快速版价格翻倍、速度也翻倍。编程评测里它拿下DeepSWE 71.0分、CursorBench 46.3分、终端任务38.0分,属于扎实的编程模型水准;但长程智能体任务只有19.6分,明显是为有边界的编程场景特调,别拿它当全能选手。
更值得注意的是首发评测里反复出现的一条提醒:这个模型单任务token消耗偏高。每百万token便宜一半,不代表你的账单便宜一半——真正该盯的口径是「完成一个任务花多少钱」。
国内同步跟进的是阶跃星辰。Step5预览版是6000亿参数的稀疏MoE架构,每次只激活270亿参数,支持百万级上下文,综合评测得分44,价格约为GPT-5.6 Sol的七分之一,并承诺10月15日全量开源。一边是xAI把旗舰砍到半价,一边是国产厂商用稀疏架构加开源把价格锚再砸一档,2026年下半年的主题词已经很清楚:性价比。多家云厂商本周同步下调推理定价,这还只是开场。
智谱这边的剧情就没那么体面了。9月17日,一位开发者清理磁盘时发现本地隐藏目录里躺着700MB的快照文件;深挖后发现,一个商业项目被打包成313MB的加密压缩包,里面装着42411个文件,近九成是代码仓库历史——每一次提交、每一个分支、连同已经删除的文件,全部在内。更讽刺的是,客户端里两个看起来像隐私开关的选项,实际控制的是训练用途和云端索引,快照上传链路开机就跑,根本没经过用户同意。
事发后智谱的整改动作倒是利落:公开道歉,3.14.0版本移除快照生成与上传链路,客户端代码以Apache 2.0协议全面开源接受社区监督,中国信通院与绿盟科技完成审计并确认云端存储数据已全部删除,同时建立了常态化的漏洞反馈奖励机制。
这件事对企业采购的杀伤力在于:编程助手和智能体天然要碰你的本地文件和代码仓库,权限边界在哪里、数据往哪儿去,过去大多靠信任。现在该换成硬条款了——数据出向清单、本地处理声明、第三方审计报告,都应该写进采购合同。我们在南宁做智能体开发交付时,这三样是标配,建议所有企业在选型时照此把关。
把三件事串起来看:Harvey用脚投票,证明闭源接口的成本模型撑不住规模化;Grok 4.7和Step5把价格锚持续往下砸;ZCode事件则把数据边界问题摆上了台面。企业AI竞争的评分表正在改写——跑分依然重要,但「单位任务成本」和「数据出向是否可控」正在变成一票否决项。
对广西的中小企业,我的建议是两句话:选模型先算单位任务成本,别被单token报价迷惑;签采购合同先要数据出向清单,别为效率把代码仓库拱手让人。落到操作层面,可以把三件事排进下周的日程:第一,把过去三个月的模型调用账单拉出来,按任务算一次真实的单位成本;第二,盘点所有正在使用编程助手和智能体的业务线,确认哪些工具在读取本地文件、数据往哪个方向流动;第三,把数据出向清单和审计条款写进下一份采购合同模板。如果贵司正在评估大模型微调或智能体落地方案,欢迎找木子科技聊聊,我们可以把这两笔账帮你算清楚。