GPT-5.6删用户文件、苹果起诉OpenAI窃密、Claude后门定调严重:7月中旬大模型格局五个裂变信号

阅读: 206 评论: 0

标签:

48小时后回过神来:最强模型也能删你的文件

7月9日,OpenAI正式向全球用户全面开放GPT-5.6系列模型。旗舰版Sol在Terminal-Bench 2.1上拿下91.9%的得分,将Claude Fable 5甩开超过8个百分点。三档定价——Sol每百万token输入5美元/输出30美元,Terra 2.5/15,Luna 1/6——看起来像是给不同用户量身定制。甚至连Luna的训练,都是Sol自主完成的:自己找GPU、写脚本、确认任务执行,全程无需人类工程师干预。OpenAI技术文档里那句"由旗舰模型自主完成后训练",很多人忽略了,但它意味着AI开始自己带徒弟了。

然而48小时不到,Sol就给用户送了一个"惊喜":7月12日凌晨,多位硅谷技术大佬发现自己的Mac主目录文件被GPT-5.6悄悄删除。OpenAI紧急发布修复补丁并致歉,但这件事把一个事实摆在了台面上——当AI Agent有了执行能力,它犯错的后果也从"回复一段胡话"升级到了"删掉你的代码仓库"。从聊天到写代码再到操作系统级操作,权力边界在飞速扩张,但安全护栏的跟进速度明显滞后。

说实话,我对这件事的反应不是震惊,是无奈。模型跑分越高、Agent能力越强,就越需要底层的沙箱隔离和操作审计。现在主流AI编程工具都能读写文件、执行命令,但没有一家把"误删用户文件"当作P0级风险提前做防护。OpenAI补丁来得快,但下次是什么?误发一封邮件?误操作数据库?Agent的权限边界问题,迟早会成为行业级安全议题。

Claude Code后门事件:工信部首次定调"危害严重"

7月8日,工信部网络安全威胁和漏洞信息共享平台(NVDB)发布公告,将Anthropic旗下AI编程工具Claude Code的安全后门隐患定性为"危害严重"——这是工信部首次对海外AI编程工具给出高等级安全定性。

事情的经过并不简单。6月30日,海外Reddit社区用户逆向拆解Claude Code,发现它内置了一段隐藏检测逻辑:读取设备时区,检查用户代理或自定义API地址是否包含147个中国云厂商、AI实验室和API中转服务商的关键词。一旦命中,就会在系统提示词中偷偷插入标记,向Anthropic服务器回传用户地域和身份标识。整套检测逻辑用XOR密钥加密混淆,埋在大量冗余代码里,常规杀毒和流量监控根本看不出来。

受影响版本覆盖2.1.91(4月2日发布)到2.1.196(6月29日发布),近三个月的主流流通版本全部中招。Anthropic回应说这是3月上线的"实验性功能",初衷是遏制账号倒卖和模型蒸馏攻击,已于7月2日推送2.1.204版本移除相关代码。但这个解释在工信部看来不够——官方公告明确要求所有企业和开发者立即排查、卸载旧版或升级到安全版本。

阿里已经在7月初发布内部通知,从7月10日起全体员工办公场景全面禁用Claude Code,将其纳入高风险软件清单。环球时报更直接发文标题为"警惕潜伏在AI时代的特洛伊木马"。这件事的深层含义在于:AI编程工具已经从聊天助手变成了供应链基础设施,如果开发工具被植入后门,风险不亚于芯片中的硬件漏洞。

苹果起诉OpenAI:400人跳槽变成商业机密案

7月11日,苹果在北加州联邦法院正式起诉OpenAI,指控其窃取商业机密。诉讼的核心数字很扎眼:超过400名前苹果员工目前就职于OpenAI,其中大量来自苹果的芯片设计、硬件和端侧AI团队。

苹果的论点不是"正常的人才流动"。招聘一两个工程师叫挖角,把一个完整部门的团队带走、让他们脑子里装着你的芯片设计方案去给竞争对手做硬件,苹果说这叫"提取"。而OpenAI确实有硬件野心——6月收购了Jony Ive的设计初创公司,加上从苹果挖来的芯片团队,明摆着要造自己的AI设备。

这件事碰巧发生在OpenAI筹备史上最大科技IPO的前夕。据报道,OpenAI正准备向SEC提交机密IPO申请,由高盛和摩根士丹利承销,目标估值约7300亿美元。但尴尬的是,Anthropic在企业API市场的年度收入已经反超OpenAI——约470亿美元年化收入,高于OpenAI预估的250-330亿美元。IPO意味着OpenAI第一次必须公开真实财务数据,和收入更高的竞争对手摆在同一张表里供投资人审视。再加上苹果的诉讼,这场IPO跑道堪称史上最受审视的科技上市。

我的判断是:AI人才战迟早会走到法庭上。不管苹果赢不赢,所有AI实验室从今天开始都会更谨慎地处理招聘流程——你雇的人来自哪、签过什么保密协议、脑子里装了什么前雇主的设计,这些都将被更严格地审查。人才流动的速度,可能要被迫降下来了。

Anthropic反超、自研芯片、误发账单——三件事串起来看

Ramp 2026年5月AI指数数据:Anthropic在企业API市场份额上首次反超OpenAI,34.4%对32.3%。在全球大模型市场份额上,OpenAI仍以约35%领先,Anthropic约25%,Google约20%,Meta约10%,但OpenAI的领先优势正在肉眼可见地收窄。

更值得关注的是Anthropic的底层动作。多家媒体报道Anthropic已启动自研AI芯片计划,拟采用三星2nm制程。如果成真,Anthropic将成为继OpenAI(Jalapeño芯片,6月25日发布)之后第二家自研AI推理芯片的前沿模型公司。推理芯片自研的趋势意味着:大模型公司不再满足于租用英伟达GPU,它们要从算力成本的最底层开始掌控自己的基础设施。

但Anthropic也有出糗的时候。7月12日凌晨,Anthropic因系统错误向免费用户发送了高达1660万美元的账单通知。用户打开一看,仪表盘显示消费却是0美元。事件引发硅谷热议,Anthropic承认错误并取消所有误发账单,承诺加强计费系统监控。说白了,跑得快的公司总会踩坑——Anthropic的增长速度在追赶基础设施的成熟度,1660万美元的账单乌龙是这种追赶的副产品。

Claude Code后门事件加误发账单加自研芯片,这三件事拼在一起看,Anthropic正处于一个典型的高速成长阵痛期:技术能力和市场份额在飞速增长,但安全合规、计费系统和基础设施的成熟度还在补课。对中国市场来说,Claude Code后门事件已经划清了数据安全底线,国产代码工具替代进程正在加速。

中国大模型出海:GLM-5.2被Coinbase采用、成本降30到95%

这条消息很多人没注意到,但在我看来它是7月中旬最具结构性意义的事件。

Databricks内部测试显示,开源模型GLM-5.2在自研基准上与Anthropic的Opus 4.8表现相当,单任务报价更低。加密货币交易所Coinbase已将工程师默认AI工具切换为GLM-5.2和Kimi 2.7的组合,推理成本降低约50%。在FrontierSWE编程基准中,GLM-5.2得分74.4,与Opus 4.8的75.1差距约1个百分点,超过GPT-5.5。OpenRouter平台数据显示,中国模型的每周流量占比从2025年11月的11%上升至超过30%。

不只是Coinbase。美国初创公司Lindy因"API费用超过全员工资"全面切换到DeepSeek;爱沙尼亚数据采集公司Floxy、加拿大律所Substance Law、英国教育平台ExpertEdge等欧美企业也相继迁移到中国大模型。每日经济新闻采访多家海外企业发现,迁移后推理成本降幅在30%到95%之间。

智谱创始人唐杰7月11日发布内部信《巨浪已来》,提出"摸高计划",围绕长程任务、自治智能体、世界模型和可信对齐四个方向直指AGI。同日,MiniMax创始人闫俊杰宣布在实现AGI之前不再领取薪酬,拿出4%个人股份激励团队、1%支持开源社区。这两封内部信背后是同一个判断:中国大模型已经过了"追赶"阶段,进入"向上突破"阶段。

7月9日,智源研究院发布悟界·RoboBrain Orca世界模型,突破了大模型仅预测文本、画面或动作的传统路径,率先实现对整体"世界状态"的前后演化推演——从"预测下一个词"迈向"预测下一个世界状态"。加上首个全国产十万卡AI超集群"曙光8000(登峰)"正式落成、美团LongCat-2.0万亿参数全开源,中国AI基础设施的自主可控能力正在快速拉满。

五个信号背后的主线

GPT-5.6删文件bug暴露Agent权限边界问题、Claude Code后门让AI工具安全成为国家关切、苹果起诉OpenAI意味着AI人才战从暗斗走向明战、Anthropic反超和自研芯片说明竞争格局正在重构、中国大模型出海加速则宣告性价比替代不是"未来趋势"而是"正在发生"。

五个看似独立的事件,其实有一条清晰的主线:AI行业正在从"能力竞赛"转向"生态安全博弈"。模型跑分当然还重要,但决定谁能留下来的,不再是单项冠军,而是谁能在安全合规、成本控制、生态开放和数据主权之间找到平衡点。对企业来说,选AI供应商的决策维度正在从"最强模型"变成"最可靠、最可控、最可负担的模型"。这个转变,比任何一次跑分刷新都更值得关注。

上一篇 > 数据产权登记指引落地:三权分置如何让企业数据变成真金白银
下一篇 > 网络数据安全风险评估办法8月落地:分级评估如何重塑企业合规路径