本周,国内大模型行业迎来WAIC 2026的集中爆发期。展览总面积首次突破10万平方米,全球1100余家龙头企业和科创团队参展,3000余项前沿AI展品亮相,超300款产品全球首发。
产品层面,月之暗面发布2.8万亿参数开源模型Kimi K3,上线48小时后因算力过载暂停C端新用户订阅;阿里巴巴发布2.4万亿参数Qwen3.8-Max预览版。
腾讯混元Hy3登顶OpenRouter全球调用量榜首;商汤、MiniMax、百川智能、面壁智能等密集发布新品。
监管层面,7月15日国家网信办首次公布七款手机端侧AI备案名单,端侧AI合规正式落地。
资本层面,DeepSeek被曝启动IPO筹备并开启新一轮融资,目标估值超5000亿元。
争议方面,Kimi K3高定价引发行业讨论,阿里Qwen3.8被指“能力比不过、价格也比不过”,OPPO旗下子品牌战略收缩,中国移动北京公司两名原董事同日被查。
监管:七款手机端侧AI完成备案,端侧AI合规正式落地
7月15日,国家互联网信息办公室公布7款提供手机端侧生成式人工智能服务的备案信息,涉及苹果、华为、OPPO、vivo、小米、三星和努比亚七家手机厂商。
具体包括:Apple智能、华为小艺AI大模型、OPPO AndesGPT大模型、vivo蓝心端侧大模型、小米澎湃AI、三星盖乐世AI、努比亚豆包手机大模型。备案时间统一为2026年7月8日。
产业分析师表示,集中备案标志着国内端侧大模型监管落地提速,手机终端AI正式纳入规范化管理。
WAIC 2026:国产大模型密集发布,多款旗舰新品同台竞技
1. 月之暗面:Kimi K3正式发布,2.8万亿参数创全球开源模型纪录
7月17日凌晨,月之暗面正式发布新一代大模型Kimi K3,该模型总参数量达2.8万亿,是全球首个开源的3万亿级别模型。
基于KDA混合线性注意力机制和注意力残差技术构建,原生支持视觉理解,拥有100万token上下文窗口。
性能层面,Kimi K3在Artificial Analysis智能指数取得57分,仅次于Claude Fable 5和GPT-5.6 Sol;在Code Arena前端开发测试中以76%胜率登顶;在DeepSWE长程开发测试中任务完成率67.5%,排名第三。
K3具备长程编码能力,可在极少人工监督下持续完成长时间工程任务。API输出定价为100元/百万tokens,输入定价20元/百万tokens。
然而,K3上线仅48小时,7月19日月之暗面宣布暂停C端新用户付费订阅,现有算力资源全部优先保障存量会员服务体验。
公告称K3上线后用户调用请求量指数级增长,整体负载逼近现有GPU集群承载上限。一款国产大模型因需求过载而主动限流,在国内AI行业中实属罕见。
2. 阿里巴巴:Qwen3.8-Max预览版上线,2.4万亿参数对标Fable 5
7月19日,阿里巴巴发布旗舰大模型Qwen3.8-Max预览版,参数规模高达2.4万亿,官方称其综合能力在全球范围内仅次于Anthropic的Fable 5,并承诺将“很快”开放完整模型权重。预览版已在阿里云Token Plan、Qoder及QoderWork上线。
此次发布时机颇为微妙,就在数日前,月之暗面刚刚发布2.8万亿参数的Kimi K3,搅动全球科技股并刷新“史上最大开放模型”纪录,而DeepSeek V4正式版也传闻将于近日上线。Qwen3.8夹在“前有K3、后有V4”的竞争格局中。
钛媒体评论指出,即便Qwen3.8综合来看是个很不错的模型,但一旦落入“能力比不过、价格也比不过”的两头不占境地,宣发上会完全找不到卖点。
3. 腾讯:混元Hy3调用量增长超68倍,登顶OpenRouter全球榜首
7月15日,腾讯官方公布,混元大模型Hy3自7月6日发布一周后,总调用量较上一代模型Hy2增长超68倍。
全球最大的API聚合平台OpenRouter数据显示,截至7月13日,Hy3在OpenRouter全球大模型调用量总榜上排名升至第一。
在Agent产品中,腾讯自研办公智能体WorkBuddy自选模型用户使用Hy3的占比达到60%。OpenRouter平台数据显示,Hy3单周消耗量突破6.13万亿Token。
腾讯混元团队于7月21日发布科研智能体Hyra-1.0,专为性能导向的研究与工程任务打造。需要指出的是,Hy3的高调用量部分受益于限时免费策略。
4. 字节跳动:Seedance模型亮相WAIC,豆包手机大模型完成备案
字节跳动Seed团队的世界模型Seedance在WAIC期间展出。7月15日,“努比亚豆包手机大模型”完成国家网信部门端侧生成式AI服务备案,字节跳动联合中兴努比亚打造的“豆包AI智能体手机”正式亮相,首批备货约10万台。
5. 商汤科技:发布SenseNova U1 Pro旗舰模型
7月18日,商汤科技在WAIC 2026正式发布大模型旗舰新品SenseNova U1 Pro。
作为“日日新SenseNova U”系列的旗舰版本,U1 Pro定位为面向长程任务的“交付级”原生多模态智能体基座,实现理解、生成和行动的深度统一。
商汤同步开源SenseNova-Vision,将检测、分割、深度估计等视觉任务统一为模型原生能力。
6. MiniMax:M3旗舰模型首发首秀,H3多模态生成模型预热
MiniMax在WAIC期间集中展示旗舰模型MiniMax M3及多模态模型和AI原生产品。M3为首发首秀,新增多模态能力使其能在智能体工具流中识别图片和视频,并能操作电脑。
新一代多模态生成模型H3在WAIC期间抢先预热。在具身智能领域,搭载MiniMax M3的Vbot超能机器狗“大头BoBo”首销预售期累计订单6540台,销售额近亿元。
7. 百川智能:M4医疗大模型首秀,HealthBench评测夺冠
百川智能首次集中展示Baichuan-M4在肿瘤、儿科等专科场景中的落地成果。与国家癌症中心、中国医学科学院肿瘤医院联合共建的肿瘤专科AI,以及与国家儿童医学中心、北京儿童医院联合共建的AI儿科医生,均已在真实临床场景中开展验证。
Baichuan-M4在HealthBench评测中得分世界第一,领先GPT-5.5超10分。
8. 面壁智能:MiniCPM5-2B发布,正式进入三星旗舰手机供应链
7月19日,面壁智能联合OpenBMB发布端侧模型MiniCPM5-2B。在Artificial Analysis榜单中,MiniCPM5-2B得17分,在全球4B参数及以下模型中排名第一。
更具里程碑意义的是,面壁智能MiniCPM系列端侧大模型正式进入三星旗舰手机供应链,成为首家打入国际手机大厂供应链的国产端侧AI模型。
面壁智能CEO李大海表示:“2026年是端侧AI规模化落地的元年”,截至2026年6月30日,MiniCPM系列开源模型累计下载量突破3800万次。
9. 华为:盘古气象大模型落地能源场景
华为联合雅砻江公司打造全国首个水风光一体化智慧运营大模型。依托华为云Stack与盘古气象大模型,融合雅砻江流域水文、地形地貌、风光资源等全域多维数据。
华为openPangu 2.0 Flash模型(920亿参数)已于6月30日开源,Pro模型权重计划7月上线。
10. 腾讯:发布三大具身基座模型
腾讯Robotics X实验室联合混元发布三项具身智能系列新模型:Hy-Embodied-VLM-1.0(视觉理解)、Hy-Embodied-RxBrain-1.0(认知规划)和Hy-Embodied-VLA-0.5(动作控制)。
首次系统性地打通“感知—身体—行动”闭环。
11. 阶跃星辰:Step Edge端侧模型全家桶发布
7月12日至13日,阶跃星辰发布Step Edge端侧模型全家桶,包含基础模型、Audio、GUI及Gen四款产品。
Step Edge基础模型在29项权威基准评测中位列同类端侧模型第一。
12. 梅卡曼德:Mech-GPT亮相WAIC,人形机器人多机协作首秀
7月17日至20日WAIC期间,梅卡曼德以"物理AI规模化落地"为主题,携通用具身智能"眼脑手"全栈技术产品亮相,首次公开展示新一代Mech-Hand多指灵巧手,自研机器人多模态大模型Mech-GPT则支持自然语言指令理解与任务推理。
人形机器人工业场景多机协作应用首次公开,两台搭载“眼脑手”全栈技术的人形机器人自主协同完成上料、装配、料筐搬运等全流程任务。
行业大模型与垂类模型动态
1. 科大讯飞:星火大模型持续迭代
科大讯飞于7月14日披露2026年半年度业绩预告,预计营收、毛利同比增长5%至10%。
与此同时,讯飞星火作为当前国内主流大模型中唯一基于全国产算力训练的通用大模型,技术实力持续获得市场认可,其AIPC产品已入围中央国家机关2026年度台式计算机框架协议采购项目。
2. 智谱AI:GLM-5.5“史诗级plus”传闻发酵
智谱创始人唐杰在回应网友时确认,新一代模型将带来“史诗级plus”提升。
业内预期新模型代号为GLM-5.5,此前GLM-5.2已在AI编程能力方面率先达到与国际顶尖模型相当的水平,调用量亦达2.58万亿Token。
3. 昆仑万维:天工短剧工作台迭代
7月16日,昆仑万维迭代天工短剧工作台,新版工作台可自动解析剧本、批量生成角色与场景数字资产、锁定人物特征。
据了解,平台将持续接入Skyreels、Seedance、Kling等主流视频大模型。
4. 中国移动九天:发布安全可信多模态大模型升级版
7月17日,中国移动在WAIC 2026企业人工智能高质量发展论坛上,正式发布九天安全可信多模态大模型升级成果与MoMA多模型服务引擎2.0。
该升级版重点解决多模态大模型在矿山、石化等工业场景中数据来源不可追溯、推理过程不可解释的痛点。35B大语言版本在国际权威榜单的轻量化模型赛道位居全球第2。
目前中国移动已携手中国电气装备、中国石油等央企及行业龙头落地。据了解,九天多模态大模型升级版已在网智运维场景日均调用超12万次。
5. 中国电信星辰:发布超级智能体TeleAgent
7月18日,中电信人工智能科技在WAIC 2026中国电信人工智能生态论坛上,正式发布星辰超级智能体TeleAgent。
作为中国电信首款AI原生应用,TeleAgent依托自研星辰大模型与国产智算底座,可理解用户需求、自动规划任务、调用工具并交付成果。
目前,产品现已正式对外全面开放,计划今年Q3推出企业版。
6. 中国联通元景:元景UniClaw随身版亮相WAIC
7月17日至20日WAIC期间,中国联通展台展出元景UniClaw随身版系列AI终端产品。
该系列以“AI随行工作盘”为定位,将大模型智能体、本地数据存储与便携硬件形态深度融合,推出直通版与eSIM版两款形态。
联通元景自研四维一体高效Token推理框架Uni-Infer,通过算网模协同降低推理成本。依托元景MaaS平台,中国联通已培育超75个工业大模型,上线150多个工业智能体。
7. 京东JoyAI:首次系统展示模型矩阵
7月18日WAIC期间,京东首次系统展示面向物理世界的JoyAI模型矩阵,开源行业最大人类视角数据集EgoLive,并打造首个JoyInside“AI Home”。同时发布JoyAI-Talker实时语音交互模型和JoyAI-Video-Edit实时视频编辑模型。
依托20多年积累的供应链能力、海量真实场景和产业数据,京东AI已广泛应用于3000多个业务场景。
8. 网易伏羲:亮相WAIC,气象卫星即将发射
7月18日下午,伏羲气象卫星星座计划在WAIC“科学智能开放论坛”启动,搭载伏羲气象大模型的气象卫星预计7月24日发射。据了解,网易近五年研发投入超800亿元。
9. 金山办公政务大模型:甘肃“公文易办”上线
7月上旬,金山办公联合武威市天马行大数据公司共同研发的甘肃省首个政务场景智能公文大模型“公文易办”正式上线投用。
该模型依托WPS 365技术底座,覆盖公文起草、智能检索、自动校核、一键排版等高频场景。
10. 360智脑:周鸿祎WAIC谈“安全+AI”
7月17日,三六零创始人周鸿祎亮相WAIC 2026,提出AI竞争进入“拼落地、拼安全”新阶段,360持续布局大模型安全、智能体安全体系建设。
此前7月2日,周鸿祎时隔一个月再度公开演示360智脑迭代进展,成为国内首家连续两次现场演示大模型的企业。
11. 迈富时Tforce:上半年净利预增近500%
7月15日,迈富时(Marketingforce)预计2026年上半年归母净利润同比增长386%至494%,AI应用业务收入增长112%至134%,
据了解,公司依托自研Tforce营销大模型提供GEO(生成式引擎优化)服务。
12. 中科院紫东太初:联合发布磐石·科学基础大模型2.0
7月17日,WAIC 2026上,中国科学院组织多个研究所联合发布磐石·科学基础大模型2.0,紫东太初团队作为联合研发团队参与攻关。
武汉人工智能研究院以紫东太初为“大脑”,已支持超50个品类机器人本体,训练超300个具身原子技能。
资本市场:DeepSeek启动IPO筹备,多家公司融资加速
DeepSeek:启动IPO筹备,新一轮融资目标超5000亿元
据彭博社援引知情人士报道,DeepSeek已启动IPO筹备工作,计划年底或2027年初正式提交上市申请。
IPO前正寻求私募市场融资,目标投前估值至少4800亿元人民币。另有报道称新一轮融资目标估值约5000亿元(约合740亿美元)。
7月16日晚间,开润股份、汤臣倍健先后发布投资进展公告,按公告数据倒推DeepSeek本轮融资后估值约3250亿至3508亿元。
据了解,DeepSeek V4正式版计划于7月中旬上线并引入峰谷定价机制,OpenRouter数据显示,DeepSeek-V4-Flash自上线以来连续七周位居全球AI大模型调用量榜首。
争议与行业风险
1. Kimi K3高定价引发行业争议,算力过载导致暂停新用户订阅
Kimi K3 输出定价达 100 元 / 百万 tokens,价格显著高于 DeepSeek-V4-Pro、小米 MiMoV2、智谱 GLM-5.2、Qwen3.7-Max 等同类模型,市场初期普遍担忧高价会造成用户流失。
但模型上线仅 48 小时,海量调用需求便耗尽现有算力储备,官方紧急叫停 C 端新用户订阅,优先保障存量会员使用体验。
除此之外,K3 采用全程保留思考历史的后训练机制,若智能体开发框架未能完整回传全部思考记录,容易引发上下文信息错乱;同时模型自主推演倾向较强,遇到任务卡点、用户指令模糊时,常会自行做出偏离用户预期的决策。。
2. 阿里Qwen3.8被指“能力比不过、价格也比不过”
钛媒体评论指出,Qwen3.8综合来看是个不错的模型,但一旦落入“能力比不过、价格也比不过”的两头不占境地,宣发上会完全找不到卖点。
3. DeepSeek V4正式版多次跳票
截至7月21日,DeepSeek V4正式版仍未上线。7月中旬已过,公众对其发布时间的关注持续升温。
4. OPPO旗下OnePlus退出欧美、realme退出中国
7月16日至17日,OPPO在一场媒体简报中确认,旗下OnePlus将退出美国与欧洲市场,不再推出新品,仅保留中国与印度市场运营;realme则将撤出中国市场,专注经营国际市场。
OPPO表示调整属全球市场部署的一部分,预计调整完成后,OPPO主品牌继续覆盖国内外市场,一加主力发展中国市场,realme聚焦海外市场。
5. 中国移动北京公司两名原董事同日被查
7月9日,中央纪委国家监委网站通报,中国移动通信集团北京有限公司原党委委员、董事、副总经理刘南、郭旗涉嫌严重违纪违法,正接受中央纪委国家监委驻中国移动纪检监察组纪律审查和北京市东城区监察委员会监察调查。
6. 小米MiMo用户反馈体验问题
有用户在社区反馈MiMo存在过度思考、陷入循环后中断执行的情况,亦有用户认为MiMo V2.5价格偏高。
7. vivo蓝心大模型用户体验争议
有用户实测反馈,vivo蓝心大模型在千元机上的体验“既不是最流畅的,也不是功能最全的”;在X300 Ultra上“90%的时间处于‘待机状态’”,实用性和响应稳定性不如宣传。
本周总结
本周国内大模型行业呈现四大特征:
监管框架确立,国家网信办首次公布七款手机端侧AI备案名单,苹果、华为、OPPO、vivo、小米、三星、努比亚七家厂商获批,端侧AI合规正式落地,为AI手机大规模商用扫清障碍。
模型规模竞赛再升级,月之暗面Kimi K3以2.8万亿参数刷新全球开源模型纪录,阿里Qwen3.8以2.4万亿参数紧随其后,国产大模型正式迈入“万亿参数时代”。
WAIC成为国产模型集体亮剑的舞台,商汤U1 Pro、MiniMax M3、百川M4、面壁MiniCPM5-2B、腾讯三大具身基座模型、中国移动九天、中国电信TeleAgent、京东JoyAI矩阵集中发布,国产大模型从“追赶”进入“并跑”阶段。
商业化与合规挑战并存,Kimi K3高定价引发行业关于“定价回归”与“用户流失”的讨论,上线48小时即因算力过载暂停新用户订阅,印证“可获取算力规模决定大模型收入上限”的判断。
OPPO子品牌战略收缩、中国移动高管被查等事件同样值得关注。
整体来看,国产大模型在技术参数和性能上已具备国际竞争力,但算力供给、商业化定价与用户体验之间的平衡仍是行业需要持续面对的核心命题。



