阅读: 332 评论: 0 点赞: 0 发布时间:发布日期:2026-07-09 08:23:40
标签:AI大模型GPT-5.6KimiAI AgentMCP协议
7 月 8 日,Axios 扔了一颗重磅炸弹:美国商务部正式批准 OpenAI 大规模推广 GPT-5.6。
这条消息的分量,怎么说呢——过去一个多月,GPT-5.6 一直处于一种尴尬的半释放状态。6 月底,OpenAI 在 Codex 底层代码中被扒出 Sol、Terra、Luna 三个子模型标识,加上一个可以调节推理速度的「速度拨盘」功能。当时所有人都以为马上要全面上线了,结果被美国政府按住,只给少数政府批准的机构开了绿灯。
OpenAI 对这件事其实不太高兴。他们公开说过,分阶段发布「不是我们的首选方式」。但胳膊拧不过大腿,还是乖乖派了技术专家团队驻扎华盛顿,配合政府的每一项测试。
现在靴子落地。根据报道,OpenAI 预计本周内完成最后准备,正式向公众推出 GPT-5.6。这意味着我们即将看到 Sol(旗舰级)、Terra(均衡型)、Luna(轻量化)三档模型同时面向普通用户开放。
这还不是终点。美国新的 AI 行政令也快落地了,目标是建立一套正式的先进 AI 模型评估框架。GPT-5.6 这次被「放行」,本质上是一次政企协作模式的演练——以后每一代前沿模型可能都要走这个流程。对国内大模型企业来说,这套「政府审查+分阶段放行」的机制也值得提前研究,毕竟全球 AI 治理的博弈不会只停留在美国本土。
月之暗面最近几组数据,放在一起看很有意思。
第一个数字:315 亿美元。这是 Kimi 新一轮融资的投前估值。就在几个月前,上一轮 200 亿美元的融资刚刚完成交割。如果你觉得这个估值涨得离谱,不妨看看第二个数字:3 亿美元。这是 Kimi 系列模型的年化经常性收入(ARR),6 月中旬刚刚突破。
更值得玩味的是第三个数字:60%。今年 Kimi API 核心模型从每百万 token 4 元涨到了 6.5 元,单次调价幅度 60%。按通常的逻辑,涨价会吓跑用户,但 Kimi 的规模收入反而涨了三倍。这说明它的代码开发、长文档处理等高价值场景确实建立了一定的不可替代性——用户不是不嫌贵,是暂时找不到更好的替代品。
K3 确认 7 月发布,参数规模传言 2.5 万亿。搭配上个月开源的 K2.7 Code(1.1 万亿参数,token 消耗直降 30%),月之暗面在「超大参数开源+商用 API 定价上调」这条路上越走越稳。不是所有人都买账——Kimi 月活从去年高峰下滑了不少——但资本市场显然在用估值投票:他们赌的不是 C 端流量,而是 API 业务和高价值企业客户。
如果 2025 年是 AI Agent 的「Demo 元年」,2026 年就是「搬进生产环境」的一年。
一个直接的数字:Anthropic 推出的 MCP(Model Context Protocol)协议,连接的外部工具和服务已经逼近 2000 个。这不是一个小生态了。与此同时,Google 的 A2A 协议和 IBM 的 ACP 协议也加入了牌局,三套智能体通信协议从年初的「概念验证」走到了现在的「分庭抗礼」。
我在实际接触中发现,企业现在对 Agent 的态度已经从「能不能做」变成了「做了之后怎么管」。几个典型问题:Agent 跑了一小时没回结果,怎么知道它是卡住了还是在思考?多个 Agent 协作时,谁来保证数据不串?GPU 资源弹性伸缩怎么做?这些都是工程问题,不是模型问题。
腾讯云 7 月初发了一篇长文讲 Agent 工程化落地,核心观点挺实在:从「对话」到「行动」的跨越,需要的不只是更强的模型,更是工具注册、输出校验和安全沙箱这些基础设施。说到底,Agent 得能「干活」而不是「聊天」,企业才会买单。
Anthropic 在 6 月悄无声息地扔出了 Claude Fable 5。没有发布会,没有 Altman 式的 Twitter 预热,只有一篇技术文档。
但 Fable 5 的底子不弱。它和 Mythos 5 共享同一套 Mythos 级底层架构——这是 Anthropic 内部比 Opus 还高的层级。SWE-bench 跑分、长周期 Agent 任务、视觉理解等维度都有明显提升。5000 万 token 的上下文窗口意味着可以一次性吃进整个代码仓库或几百页的法律合同。
不过 Anthropic 也遇到了和 OpenAI 类似的麻烦——美国政府对其 Mythos 和 Fable 模型也施加了类似 GPT-5.6 的出口管制和分阶段限制。所以现在形成了这样一个局面:美国政府在同时「审查」两家最顶尖的 AI 公司,而且审查的节奏和力度正在变成行业常态。
这对中国 AI 企业来说,既是挑战也是窗口。出口管制意味着前沿模型的获取成本会更高,但国产替代的市场空间也在被这个「管制窗口」撑大。
DeepSeek V4 已经正式上线,1M 上下文、思考模式、全平台免费。加上之前开源的 OpenCode Agent 在 SWE-bench 上反超 Cursor 的成绩——一个清晰的趋势正在形成:开源模型+免费策略正在重新定义竞争规则。
DeepSeek V4 的免费策略对行业的影响可能是结构性的。当一个百万级上下文、推理能力不输闭源旗舰的模型完全免费开放时,那些靠 API 收费维持估值的公司就需要重新想一下自己的护城河到底在哪里。
但硬币有两面。免费策略本身也面临可持续性的拷问——DeepSeek 背后有量化交易的现金流支撑,其他公司怎么跟?开源模型训练和推理成本居高不下,今年下半年可能会有一批中小模型公司面临资金链压力。
我其实觉得,开源和闭源不会是谁吃掉谁的关系。更可能的情况是:开源做「底座」,闭源做「精调」——在垂直场景里,能交付结果的企业永远有自己的生存空间。
回到今天这五个信号,串起来看其实有一条主线:大模型行业正在从「比谁模型大」切换到「比谁能落地」。
GPT-5.6 获批意味着最先进的模型即将全面开放,但政府的审查框架也在同步建立——这不是管制结束,而是管制制度化。Kimi K3 的估值翻倍说明资本市场仍然看好超大参数路线,但前提是你能证明自己在高价值场景里不可替代。Agent 的工程化落地和 MCP 协议生态的扩张,指向的是同一个方向:模型的价值不在模型本身,而在它能不能嵌入企业的真实工作流。
对于中小企业来说,现在不是观望的时候。GPT-5.6 全面开放之后,AI 能力的供给曲线会再一次陡峭上升——这意味着「用 AI 提效」的门槛会继续降低,但「不用 AI」的竞争劣势会继续拉大。选一个具体的场景,先跑起来,可能是当下最务实的策略。