阅读: 239 评论: 0 点赞: 0 发布时间:发布日期:2026-07-20 08:23:07
标签:AI大模型DeepSeekKimiAnthropicOpenAI
7月20日这一天,发生了几件值得认真聊聊的事。
深度求索放出了DeepSeek V4的"满血版"——Flash和Pro双版本,峰谷计费,编码直追GPT-5.6 Sol,整体跑分逼近Anthropic Opus 4.8。同一天,Fable 5免费时代正式结束,从今天起按量收费,$10/$50每百万token。而就在两天前,Kimi K3发布后不到24小时,Anthropic做出一个让整个行业都意外的决定:推翻Fable 5的下线计划,改为永久开放。
如果再算上Grok Build上周被曝秘密上传用户整个代码仓库(包括SSH密钥和密码库)的安全丑闻,以及7月28日MCP协议即将发布史上最大修订——这48小时内释放的信号密度,说实话,比过去一个月的行业报告都来得猛。
下面展开聊四个最值得关注的信号。
先说今天的主角。
7月20日,DeepSeek V4正式版终于亮相,分V4 Flash和V4 Pro两个版本。其实此前V4的基础能力大家已经通过各种渠道摸了个大概——开源社区的A/B测试、第三方评测平台的跑分——但今天这两个版本才是真正面向生产环境的产品。
几个数字值得注意:V4 Pro每百万输出token平峰期0.87美元,高峰期翻倍;Flash低至0.28美元。在编码能力上,早期测试者反馈"直追GPT-5.6 Sol",整体综合能力"接近Opus 4.8"。考虑到Opus 4.8的定价是V4 Pro的几十倍,这不是技术上的对等,而是性价比上的一次降维打击。
峰谷计费这套逻辑,在国内大模型厂商里是第一个。说白了就是把云计算的弹性定价搬到了模型推理上——白天忙时贵一些,晚上便宜。对中小企业来说,批量处理、夜间推理这些场景的成本会非常可观地降下来。我认为这是比模型跑分更值得关注的信号:它说明DeepSeek开始认真思考"大规模商用"这个命题,而不只是在刷榜。
还有一个时间节点别忘了:7月24日,DeepSeek旧版API(deepseek-chat和deepseek-reasoner)将正式停用,所有用户必须迁移到V4。这是一个硬性截止日期,没有缓冲期。如果你公司还在用旧版接口,今天就得开始动起来了。
这是上周最戏剧性的一幕。
7月17日,月之暗面发布Kimi K3,参数规模、上下文窗口和编程能力全面升级,完整权重定在7月27日开源。发布前,Anthropic的原计划很清楚:Fable 5在7月25日下线,之后按量计费,等算力宽裕了再说。
但K3发布后不到24小时,Anthropic的态度拐了一个180度的弯——7月18日,官方宣布Fable 5永久对外开放,不再有下线日期。外媒和社区的解读几乎没有分歧:中国大模型的硬核竞争力,是这次政策转向最关键的外部因素。
我其实觉得这个判断站得住脚。回顾过去几个月的数据:Coinbase把GLM 5.2和Kimi K2.7设成工程师的默认模型,AI账单直接砍掉将近一半;Cursor拿Kimi K2.5做基座优化出Composer,然后被SpaceX以600亿美元收购;Fireworks作为Kimi的推理合作伙伴,7个月估值从40亿美元冲到150亿美元。这不是实验室里的跑分故事,这是真金白银的商业选择。
Anthropic自己心里很清楚:如果不把Fable 5留在牌桌上,K3+DeepSeek V4的组合会在性价比这条赛道上蚕食大量开发者。Fable 5免费期的三次延期(7月7日→7月12日→7月19日),与其说是算力不足,不如说是在等一个合适的竞争时机。K3的发布就是这个时机。
结论很简单:中国大模型已经不再只是"便宜替代品"。它正在成为国际市场上的一个严肃选项,而且这个趋势不可逆。
7月19-20日这24小时,编程Agent赛道发生了三件相互关联的事。
第一件,Fable 5从今天起正式告别免费时代。$10/M输入、$50/M输出,重型任务(50K输入+15K输出)一次大约$1.25,如果每天跑30次,月账单轻松破$1,100。Anthropic的建议是把常规工作切到Sonnet 5($2/$10/M),只在确实需要Fable 5的SWE-bench Pro 80.4%准确率时才用。这个建议很理性,但也说明一个现实:最强的模型正在变成奢侈品。
第二件,OpenAI宣布收购德国公司Ona(前Gitpod),为Codex注入持久化云Agent能力。Codex目前的周活用户已经超过500万。Ona的核心能力是让Agent在云环境中持续运行——你关掉笔记本睡觉,Codex继续在云端重构代码、生成测试、写文档。这是7月份编程工具赛道的第三笔重大整合,前两笔是SpaceX收购Cursor(600亿美元)和Anthropic推出Ode(企业前向部署AI工程师)。编程Agent的军备竞赛已经到了"谁先关灯谁就输"的阶段。
第三件,Grok Build暴雷。AI安全研究员Cereblab发现,xAI的命令行工具Grok Build在用户明确指示"不要打开某些文件"的情况下,仍然把整个代码仓库——包括完整的Git历史、SSH密钥、密码管理器数据库——上传到了Google Cloud Storage。马斯克承诺清除数据,但没有任何事件报告、没有确认受影响用户数、没有确认漏洞是否已修复。这不是一个功能bug,这是安全基础设施的彻底失效。
三件事放一起看,编程Agent市场正在经历一个奇特的"三速分化":上层,Anthropic和OpenAI在云端Agent持久化能力上疯狂投入;中层,中国模型用极致性价比蚕食开发者市场;底层,安全治理的短板正在成为最容易被忽视的致命伤。
如果说模型竞赛是前沿阵地的炮火,那MCP协议的升级就是后勤补给线的重构。
7月28日,Model Context Protocol将发布正式版(2026-07-28规范),这是MCP自2024年11月诞生以来最大的一次修订。四个核心变化:无状态架构让大规模商用部署成为可能;统一能力发现机制让成百上千个工具不再"平铺"而是可治理;任务从单次调用走向持续执行(multi round-trip、Tasks、MCP Apps);结果从"模型说了什么"走向"依据能否还原"(JSON Schema 2020-12 + W3C Trace Context)。
用企查查技术总监杜虎的话说:API解决"能不能调用",MCP解决"能不能可信地完成业务任务"。企查查已经完成新版候选规范的全适配,上了9组Server、197项工具、27套业务Skill。
但MCP的高歌猛进也在引发反弹。谷歌、微软、Salesforce在7月13日被曝秘密组建了一个"反MCP联盟",推自己的企业Agent互操作框架。他们的底层逻辑不难理解:MCP虽然开源,但规范制定权在Anthropic手里,而MCP的月活SDK下载量已经到9,700万,企业采用率78%。谁控制了协议的标准,谁就控制了企业AI基础设施的架构权。
这不是一个好或坏的问题。对国内企业来说,一个现实的问题是:MCP 7月28日版规范发布后,你的Agent数据基座能不能适配新标准的无状态架构?你的工具调用链能不能做到全链路可追溯?你的行业语义能不能被Agent正确理解而不是靠模型"猜"?这些问题比模型跑分重要得多。因为跑分差5个百分点可能不耽误干活,但Agent调错一个数据字段可能造成实际业务损失。
把今天这四个信号串起来,一条主线其实很清楚。
DeepSeek V4满血版上线,峰谷计价意味着中国模型开始用商业策略竞争而不只是卷参数;Kimi K3逼Anthropic保留Fable 5,证明中国模型在性能上已经到了能影响国际巨头决策的水平;编程Agent的24小时三重奏说明云端持久化能力和安全治理正在成为新的竞争维度;MCP 7月28日正式版则提醒所有人——Agent真正走进生产环境,不是靠更强的模型,而是靠可信、可追溯、可规模化的基础设施。
2026年7月下旬,大模型的故事已经从"谁更强"变成了"谁能用"。模型的参数是炮弹,基础设施是炮架。有炮弹没炮架,顶多听个响。