阅读: 439 评论: 0 点赞: 0 发布时间:发布日期:2026-09-01 08:23:18
标签:南宁大模型南宁模型微调DeepSeek多模态开源腾讯AI架构调整欧盟DSA监管
9月1日,DeepSeek在Hugging Face上放出了DeepSeek-V4-Flash-Vision-Exp。名字很长,但分量不轻——这是V4系列第一款"能看图"的模型,305B总参数,每token只激活13B,激活率低到百分之4.6,采用MIT协议开源,权重、分词器、提示编码参考实现和最小化推理代码全部可直接下载。
跑分方面,ZeroBench拿到35分,反超Opus-4.8的34分;Terminal Bench 83.9,离Opus的85.0只差1.1分;真实软件工程测试DeepSWE从54.4提升到59.3,直接登顶。工具调用Toolathlon-Verified得75.9,仅落后第一名0.3个百分点。多模态Agent能力已经逼近闭源前沿,而纯文本能力与V4-Flash保持一致。
说实话,我关注的不只是跑分。真正值得琢磨的是两件事:第一,激活率百分之4.6比腾讯Hy4的百分之6.4还激进,说明路由质量正在成为新的护城河——谁能在更少的激活参数里挤出更多能力,谁就在推理成本上占先;第二,MIT协议意味着零成本商用,小团队拿消费级显卡就能跑或微调,这对闭源前沿模型的定价压力是实打实的。
同一天,科大讯飞也开源了星火X2.5-4B和1.7B两款端侧模型,原生支持100万token上下文,瞄准车载终端和智能硬件场景。9月7日还要发293B的基座模型。加上已经在跑的阿里Qwen3.8-Max和Meta Muse Glimmer,开放权重生态正在从"文本追平"切换到"多模态加Agent追平"的新阶段。以前开源模型是"能用但不够好",现在开始变成"够好且免费"——这个转折对企业选型的影响会越来越明显。
同样是8月31日,腾讯混元发布并开源了Hy4 preview——770B总参数的MoE模型,激活49B,上下文突破100万token。CodeArena WebDev全球排第五,SWE-bench Pro拿到65.7分。已经在WorkBuddy和元宝等产品中首发。投行反应也快:中金维持"跑赢行业"评级目标价666港元,花旗重申"买入"目标765港元,都提到Hy4 preview发布早于预期。
但比模型本身更值得说的是组织变动。9月1日,腾讯任命姚顺雨为首席AI科学家兼基础模型部负责人,同日撤销了存在十年的AI Lab。十年——这个时间跨度放在中国互联网公司里不算短。AI Lab曾经是腾讯AI研究的招牌之一,如今被拆掉,说明腾讯的AI战略正在从"分散探索"转向"集中攻坚"。
姚顺雨是谁?他是卡内基梅隆大学的AI研究背景,加入腾讯不到一年就推动Hy4从训练到开源。把基础模型部单独拎出来、由首席AI科学家直管,对应的逻辑很清楚:大模型已经不是众多AI方向中的一个,而是所有AI方向的地基。以前AI Lab可以同时做计算机视觉、语音、自然语言、机器人,各搞各的;现在这些方向都要长在同一个基座模型上,组织架构不收拢就没法形成合力。
组织集中化的同时,产业落地也在加速。长信基金与腾讯云签署战略协议,成为公募行业首家与腾讯云达成信创加AI全栈合作的基金公司。海光信息联合腾讯云开源项目Cube Sandbox完成全栈优化,解决了高并发微型虚拟机调度抖动等痛点,补齐了国产算力AI Agent沙箱的短板。一边是内部架构收拢,一边是外部生态绑定——"集中力量办大事"的意图很明确。
第三件事和前两件的方向完全不同。8月31日,欧盟委员会依据《数字服务法》把OpenAI旗下的ChatGPT认定为"超大型在线搜索引擎"(VLOSE),同日把Reddit和Roblox认定为"超大型在线平台"。三者在欧盟月活都超过4500万,必须在12月底前履行系统性风险评估、算法透明度、独立审计和实时数据报送等额外义务。违规最高罚全球年营收的百分之6。
这是生成式AI服务第一次被正式纳入欧盟"超级平台"监管框架。而且分类很讲究——不是普通平台,是搜索引擎。这意味着ChatGPT要按搜索引擎的规则承担风险缓解和透明度义务,比如搜索功能的内容标注、推荐算法的可解释性。监管的重心从"平台规模"转向"系统性社会影响",对OpenAI在欧盟的运营成本和产品形态都会产生长期约束。
说实话,这个时间点很微妙。OpenAI刚宣布广告业务年化收入达到10亿美元、要全球扩张,转头就被欧盟拉进了最严监管名单。一边是商业化加速,一边是合规成本上升——这两条线的交叉点在哪,决定了ChatGPT能不能在欧洲站住脚。其他司法辖区会不会跟进?至少先例已经立在这里了。
国内这边也在同步加码,但方向不同。工信部办公厅发布人工智能应用服务商培育专项行动通知,提出到2027年底服务商资源池不少于3000家,探索通过首购首用、风险补偿等模式加大大模型和智能体服务采购力度,并推动AI项目出海。和欧盟的"管住你"不同,中国政策是"扶一把再加管"——既用采购订单拉动需求,又用资源池门槛筛掉不靠谱的供应商。两条路殊途同归:AI治理都在从企业自律转向制度性约束。
综合来看,9月1日这三件事指向同一个判断:AI竞争的核心变量已经不单是模型能力了。"开放权重生态加可控合规部署加端边云算力协同"正在成为新的系统化较量维度。对企业而言,合规、可观测和安全将和模型性能一样重要——选模型不只看跑分,还得看审计能不能过、数据驻留在哪、出了事谁负责。对开发者而言,开放权重降低了创新门槛,但部署侧的合规成本会成为新的分水岭。开源追上闭源、大厂收拢AI、监管拉下铁幕——三条线同时拐弯,这个9月注定不平静。