AI大模型周报:月之暗面开源全球最大模型;面壁智能进入三星供应链;Kimi K3因算力过载暂停新用户订阅…
2026-07-21 19:29 AI大模型

AI大模型周报:月之暗面开源全球最大模型;面壁智能进入三星供应链;Kimi K3因算力过载暂停新用户订阅…23

本周,国内大模型行业迎来WAIC 2026的集中爆发期。展览总面积首次突破10万平方米,全球1100余家龙头企业和科创团队参展,3000余项前沿AI展品亮相,超300款产品全球首发。

 

产品层面,月之暗面发布2.8万亿参数开源模型Kimi K3,上线48小时后因算力过载暂停C端新用户订阅;阿里巴巴发布2.4万亿参数Qwen3.8-Max预览版

 

腾讯混元Hy3登顶OpenRouter全球调用量榜首;商汤、MiniMax、百川智能、面壁智能等密集发布新品。

 

监管层面,715日国家网信办首次公布七款手机端侧AI备案名单,端侧AI合规正式落地。

 

资本层面,DeepSeek被曝启动IPO筹备并开启新一轮融资,目标估值超5000亿元。

 

争议方面,Kimi K3高定价引发行业讨论,阿里Qwen3.8被指能力比不过、价格也比不过OPPO旗下子品牌战略收缩,中国移动北京公司两名原董事同日被查。

 

监管:七款手机端侧AI完成备案,端侧AI合规正式落地

 

715日,国家互联网信息办公室公布7款提供手机端侧生成式人工智能服务的备案信息,涉及苹果、华为、OPPOvivo、小米、三星和努比亚七家手机厂商。

 

具体包括:Apple智能、华为小艺AI大模型、OPPO AndesGPT大模型、vivo蓝心端侧大模型、小米澎湃AI、三星盖乐世AI、努比亚豆包手机大模型。备案时间统一为202678日。

 

产业分析师表示,集中备案标志着国内端侧大模型监管落地提速,手机终端AI正式纳入规范化管理。

 

WAIC 2026:国产大模型密集发布,多款旗舰新品同台竞技

 

1. 月之暗面:Kimi K3正式发布,2.8万亿参数创全球开源模型纪录

 

717日凌晨,月之暗面正式发布新一代大模型Kimi K3该模型总参数量达2.8万亿,是全球首个开源的3万亿级别模型。

 

基于KDA混合线性注意力机制和注意力残差技术构建,原生支持视觉理解,拥有100token上下文窗口。

 

性能层面,Kimi K3Artificial Analysis智能指数取得57分,仅次于Claude Fable 5GPT-5.6 Sol;在Code Arena前端开发测试中以76%胜率登顶;在DeepSWE长程开发测试中任务完成率67.5%,排名第三。

 

K3具备长程编码能力,可在极少人工监督下持续完成长时间工程任务。API输出定价为100/百万tokens,输入定价20/百万tokens

 

然而,K3上线仅48小时,719日月之暗面宣布暂停C端新用户付费订阅,现有算力资源全部优先保障存量会员服务体验。

 

公告称K3上线后用户调用请求量指数级增长,整体负载逼近现有GPU集群承载上限。一款国产大模型因需求过载而主动限流,在国内AI行业中实属罕见。

 

2. 阿里巴巴:Qwen3.8-Max预览版上线,2.4万亿参数对标Fable 5

 

719日,阿里巴巴发布旗舰大模型Qwen3.8-Max预览版,参数规模高达2.4万亿,官方称其综合能力在全球范围内仅次于AnthropicFable 5,并承诺将很快开放完整模型权重。预览版已在阿里云Token PlanQoderQoderWork上线。

 

此次发布时机颇为微妙就在数日前月之暗面刚刚发布2.8万亿参数的Kimi K3,搅动全球科技股并刷新史上最大开放模型纪录DeepSeek V4正式版也传闻将于近日上线。Qwen3.8夹在前有K3、后有V4”的竞争格局中。

 

钛媒体评论指出,即便Qwen3.8综合来看是个很不错的模型,但一旦落入能力比不过、价格也比不过的两头不占境地,宣发上会完全找不到卖点。

 

3. 腾讯:混元Hy3调用量增长超68倍,登顶OpenRouter全球榜首

 

715日,腾讯官方公布,混元大模型Hy376日发布一周后,总调用量较上一代模型Hy2增长超68倍。

 

全球最大的API聚合平台OpenRouter数据显示,截至713日,Hy3OpenRouter全球大模型调用量总榜上排名升至第一。

 

Agent产品中,腾讯自研办公智能体WorkBuddy自选模型用户使用Hy3的占比达到60%OpenRouter平台数据显示,Hy3单周消耗量突破6.13万亿Token

 

腾讯混元团队于721日发布科研智能体Hyra-1.0,专为性能导向的研究与工程任务打造。需要指出的是,Hy3的高调用量部分受益于限时免费策略。

 

4. 字节跳动:Seedance模型亮相WAIC,豆包手机大模型完成备案

 

字节跳动Seed团队的世界模型SeedanceWAIC期间展出。715日,努比亚豆包手机大模型完成国家网信部门端侧生成式AI服务备案字节跳动联合中兴努比亚打造的豆包AI智能体手机正式亮相,首批备货约10万台。

 

5. 商汤科技:发布SenseNova U1 Pro旗舰模型

 

718日,商汤科技在WAIC 2026正式发布大模型旗舰新品SenseNova U1 Pro

 

作为日日新SenseNova U”系列的旗舰版本,U1 Pro定位为面向长程任务的交付级原生多模态智能体基座,实现理解、生成和行动的深度统一。

 

商汤同步开源SenseNova-Vision,将检测、分割、深度估计等视觉任务统一为模型原生能力。

 

6. MiniMaxM3旗舰模型首发首秀,H3多模态生成模型预热

 

MiniMaxWAIC期间集中展示旗舰模型MiniMax M3及多模态模型和AI原生产品。M3为首发首秀,新增多模态能力使其能在智能体工具流中识别图片和视频,并能操作电脑。

 

新一代多模态生成模型H3WAIC期间抢先预热。在具身智能领域,搭载MiniMax M3Vbot超能机器狗大头BoBo”首销预售期累计订单6540台,销售额近亿元。

 

7. 百川智能:M4医疗大模型首秀,HealthBench评测夺冠

 

百川智能首次集中展示Baichuan-M4在肿瘤、儿科等专科场景中的落地成果。与国家癌症中心、中国医学科学院肿瘤医院联合共建的肿瘤专科AI,以及与国家儿童医学中心、北京儿童医院联合共建的AI儿科医生,均已在真实临床场景中开展验证。

 

Baichuan-M4HealthBench评测中得分世界第一,领先GPT-5.510分。

 

8. 面壁智能:MiniCPM5-2B发布,正式进入三星旗舰手机供应链

 

719日,面壁智能联合OpenBMB发布端侧模型MiniCPM5-2B。在Artificial Analysis榜单中,MiniCPM5-2B17分,在全球4B参数及以下模型中排名第一。

 

更具里程碑意义的是,面壁智能MiniCPM系列端侧大模型正式进入三星旗舰手机供应链,成为首家打入国际手机大厂供应链的国产端侧AI模型。

 

面壁智能CEO李大海表示:“2026年是端侧AI规模化落地的元年截至2026630日,MiniCPM系列开源模型累计下载量突破3800万次。

 

9. 华为:盘古气象大模型落地能源场景

 

华为联合雅砻江公司打造全国首个水风光一体化智慧运营大模型。依托华为云Stack与盘古气象大模型,融合雅砻江流域水文、地形地貌、风光资源等全域多维数据。

 

华为openPangu 2.0 Flash模型(920亿参数)已于630日开源,Pro模型权重计划7月上线。

 

10. 腾讯:发布三大具身基座模型

 

腾讯Robotics X实验室联合混元发布三项具身智能系列新模型:Hy-Embodied-VLM-1.0(视觉理解)、Hy-Embodied-RxBrain-1.0(认知规划)和Hy-Embodied-VLA-0.5(动作控制)。

 

首次系统性地打通感知身体行动闭环。

 

11. 阶跃星辰:Step Edge端侧模型全家桶发布

 

712日至13日,阶跃星辰发布Step Edge端侧模型全家桶,包含基础模型、AudioGUIGen四款产品。

 

Step Edge基础模型在29项权威基准评测中位列同类端侧模型第一。

 

12. 梅卡曼德:Mech-GPT亮相WAIC,人形机器人多机协作首秀

 

717日至20WAIC期间,梅卡曼德以"物理AI规模化落地"为主题,携通用具身智能"眼脑手"全栈技术产品亮相,首次公开展示新一代Mech-Hand多指灵巧手,自研机器人多模态大模型Mech-GPT则支持自然语言指令理解与任务推理。

 

人形机器人工业场景多机协作应用首次公开两台搭载眼脑手全栈技术的人形机器人自主协同完成上料、装配、料筐搬运等全流程任务。

 

行业大模型与垂类模型动态

 

1. 科大讯飞:星火大模型持续迭代

 

科大讯飞于714日披露2026年半年度业绩预告,预计营收、毛利同比增长5%10%

 

与此同时,讯飞星火作为当前国内主流大模型中唯一基于全国产算力训练的通用大模型,技术实力持续获得市场认可,其AIPC产品已入围中央国家机关2026年度台式计算机框架协议采购项目。

 

2. 智谱AIGLM-5.5“史诗级plus”传闻发酵

 

智谱创始人唐杰在回应网友时确认,新一代模型将带来史诗级plus”提升。

 

业内预期新模型代号为GLM-5.5,此前GLM-5.2已在AI编程能力方面率先达到与国际顶尖模型相当的水平,调用量亦达2.58万亿Token

 

3. 昆仑万维:天工短剧工作台迭代

 

716日,昆仑万维迭代天工短剧工作台新版工作台可自动解析剧本、批量生成角色与场景数字资产、锁定人物特征。

 

据了解,平台将持续接入SkyreelsSeedanceKling等主流视频大模型。

 

4. 中国移动九天:发布安全可信多模态大模型升级版

 

717日,中国移动在WAIC 2026企业人工智能高质量发展论坛上,正式发布九天安全可信多模态大模型升级成果与MoMA多模型服务引擎2.0

 

该升级版重点解决多模态大模型在矿山、石化等工业场景中数据来源不可追溯、推理过程不可解释的痛点。35B大语言版本在国际权威榜单的轻量化模型赛道位居全球第2

 

目前中国移动已携手中国电气装备、中国石油等央企及行业龙头落地。据了解,九天多模态大模型升级版已在网智运维场景日均调用超12万次。

 

5. 中国电信星辰:发布超级智能体TeleAgent

 

718日,中电信人工智能科技在WAIC 2026中国电信人工智能生态论坛上,正式发布星辰超级智能体TeleAgent

 

作为中国电信首款AI原生应用,TeleAgent依托自研星辰大模型与国产智算底座,可理解用户需求、自动规划任务、调用工具并交付成果。

 

目前,产品现已正式对外全面开放,计划今年Q3推出企业版。

 

6. 中国联通元景:元景UniClaw随身版亮相WAIC

 

717日至20WAIC期间,中国联通展台展出元景UniClaw随身版系列AI终端产品。

 

该系列以“AI随行工作盘为定位,将大模型智能体、本地数据存储与便携硬件形态深度融合,推出直通版与eSIM版两款形态。

 

联通元景自研四维一体高效Token推理框架Uni-Infer,通过算网模协同降低推理成本。依托元景MaaS平台,中国联通已培育超75个工业大模型,上线150多个工业智能体。

 

7. 京东JoyAI:首次系统展示模型矩阵

 

718WAIC期间,京东首次系统展示面向物理世界的JoyAI模型矩阵,开源行业最大人类视角数据集EgoLive,并打造首个JoyInside“AI Home”。同时发布JoyAI-Talker实时语音交互模型和JoyAI-Video-Edit实时视频编辑模型。

 

依托20多年积累的供应链能力、海量真实场景和产业数据,京东AI已广泛应用于3000多个业务场景。

 

8. 网易伏羲:亮相WAIC,气象卫星即将发射

 

718日下午,伏羲气象卫星星座计划在WAIC“科学智能开放论坛启动搭载伏羲气象大模型的气象卫星预计724日发射。据了解,网易近五年研发投入超800亿元。

 

9. 金山办公政务大模型:甘肃公文易办上线

 

7月上旬,金山办公联合武威市天马行大数据公司共同研发的甘肃省首个政务场景智能公文大模型公文易办正式上线投用。

 

该模型依托WPS 365技术底座,覆盖公文起草、智能检索、自动校核、一键排版等高频场景。

 

10. 360智脑:周鸿祎WAIC安全+AI”

 

717日,三六零创始人周鸿祎亮相WAIC 2026,提出AI竞争进入拼落地、拼安全新阶段360持续布局大模型安全、智能体安全体系建设。

 

此前72日,周鸿祎时隔一个月再度公开演示360智脑迭代进展,成为国内首家连续两次现场演示大模型的企业。

 

11. 迈富时Tforce:上半年净利预增近500%

 

715日,迈富时(Marketingforce)预计2026年上半年归母净利润同比增长386%494%AI应用业务收入增长112%134%

 

据了解,公司依托自研Tforce营销大模型提供GEO(生成式引擎优化)服务。

 

12. 中科院紫东太初:联合发布磐石·科学基础大模型2.0

 

717日,WAIC 2026上,中国科学院组织多个研究所联合发布磐石·科学基础大模型2.0紫东太初团队作为联合研发团队参与攻关。

 

武汉人工智能研究院以紫东太初为大脑,已支持超50个品类机器人本体,训练超300个具身原子技能。

 

资本市场:DeepSeek启动IPO筹备,多家公司融资加速

 

DeepSeek:启动IPO筹备,新一轮融资目标超5000亿元

 

据彭博社援引知情人士报道,DeepSeek已启动IPO筹备工作,计划年底或2027年初正式提交上市申请。

 

IPO前正寻求私募市场融资,目标投前估值至少4800亿元人民币。另有报道称新一轮融资目标估值约5000亿元(约合740亿美元)。

 

716日晚间,开润股份、汤臣倍健先后发布投资进展公告,按公告数据倒推DeepSeek本轮融资后估值约3250亿至3508亿元。

 

据了解,DeepSeek V4正式版计划于7月中旬上线并引入峰谷定价机制OpenRouter数据显示DeepSeek-V4-Flash自上线以来连续七周位居全球AI大模型调用量榜首。

 

争议与行业风险

 

1. Kimi K3高定价引发行业争议,算力过载导致暂停新用户订阅

 

Kimi K3 输出定价达 100 / 百万 tokens,价格显著高于 DeepSeek-V4-Pro、小米 MiMoV2、智谱 GLM-5.2Qwen3.7-Max 等同类模型,市场初期普遍担忧高价会造成用户流失。

 

但模型上线仅 48 小时,海量调用需求便耗尽现有算力储备,官方紧急叫停 C 端新用户订阅,优先保障存量会员使用体验。

 

除此之外,K3 采用全程保留思考历史的后训练机制,若智能体开发框架未能完整回传全部思考记录,容易引发上下文信息错乱;同时模型自主推演倾向较强,遇到任务卡点、用户指令模糊时,常会自行做出偏离用户预期的决策。。

 

2. 阿里Qwen3.8被指能力比不过、价格也比不过

 

钛媒体评论指出,Qwen3.8综合来看是个不错的模型,但一旦落入能力比不过、价格也比不过的两头不占境地,宣发上会完全找不到卖点。

 

3. DeepSeek V4正式版多次跳票

 

截至721日,DeepSeek V4正式版仍未上线。7月中旬已过,公众对其发布时间的关注持续升温。

 

4. OPPO旗下OnePlus退出欧美、realme退出中国

 

716日至17日,OPPO在一场媒体简报中确认,旗下OnePlus将退出美国与欧洲市场,不再推出新品,仅保留中国与印度市场运营;realme则将撤出中国市场,专注经营国际市场。

 

OPPO表示调整属全球市场部署的一部分预计调整完成后,OPPO主品牌继续覆盖国内外市场,一加主力发展中国市场,realme聚焦海外市场。

 

5. 中国移动北京公司两名原董事同日被查

 

79日,中央纪委国家监委网站通报,中国移动通信集团北京有限公司原党委委员、董事、副总经理刘南、郭旗涉嫌严重违纪违法,正接受中央纪委国家监委驻中国移动纪检监察组纪律审查和北京市东城区监察委员会监察调查。

 

6. 小米MiMo用户反馈体验问题

 

有用户在社区反馈MiMo存在过度思考、陷入循环后中断执行的情况,亦有用户认为MiMo V2.5价格偏高。


22.png 

 

7. vivo蓝心大模型用户体验争议

 

有用户实测反馈,vivo蓝心大模型在千元机上的体验既不是最流畅的,也不是功能最全的;在X300 Ultra“90%的时间处于待机状态’”,实用性和响应稳定性不如宣传。

 

本周总结

 

本周国内大模型行业呈现四大特征:

 

监管框架确立国家网信办首次公布七款手机端侧AI备案名单,苹果、华为、OPPOvivo、小米、三星、努比亚七家厂商获批,端侧AI合规正式落地,为AI手机大规模商用扫清障碍。

 

模型规模竞赛再升级月之暗面Kimi K32.8万亿参数刷新全球开源模型纪录,阿里Qwen3.82.4万亿参数紧随其后,国产大模型正式迈入万亿参数时代

 

WAIC成为国产模型集体亮剑的舞台商汤U1 ProMiniMax M3、百川M4、面壁MiniCPM5-2B、腾讯三大具身基座模型、中国移动九天、中国电信TeleAgent、京东JoyAI矩阵集中发布,国产大模型从追赶进入并跑阶段。

 

商业化与合规挑战并存Kimi K3高定价引发行业关于定价回归用户流失的讨论,上线48小时即因算力过载暂停新用户订阅,印证可获取算力规模决定大模型收入上限的判断。

 

OPPO子品牌战略收缩、中国移动高管被查等事件同样值得关注。

 

整体来看,国产大模型在技术参数和性能上已具备国际竞争力,但算力供给、商业化定价与用户体验之间的平衡仍是行业需要持续面对的核心命题。


88.jpg