
如果说8月是用价格表证明大模型能做生意,那么9月就是摊开发展蓝图,持续探索发展的上限。新一代旗舰训练规模直指5万亿至10万亿参数,配套芯片算力是前代3倍;552B参数的新架构Flash把长文本缓存压掉近九成,缓存命中价低至每百万tokens两分钱,接棒默认主力。更关键的是,旗舰模型在人类几乎零参与下自主完成33轮迭代,基准分从40提至45,标志着大模型开始自己训练自己。
市场上,一边是资本与算力的双重加码:巨额股债融资落地,年末收入指引上调四分之一,算力不再是增长瓶颈;另一边是智能体密集“上岗”:无代码商单平台打通商业链路,办公智能体登上手机,线下门店批量驻场。开源侧同样热闹:600B稀疏新旗舰跻身全球前三,世界模型登顶评测,端侧模型串起人车家。
在大模型之家《2026年9月大模型热力榜》中,我们共收录了660余个大模型及其所属企业。当自我改进成为变量、基建成为军备竞赛、智能体从演示走向岗位,9月的规律已经清晰:竞争正从参数与定价的单点比拼,升维为“算力—模型—智能体—收入”的闭环之战。

阿里巴巴:云栖大会公布Qwen4训练路线,全栈AI基建密集落地
9月1日,阿里云百炼平台上线Qwen3.8-Max-0902多模态大模型,重点提升工程级编程、长程自动开发及端到端智能体任务能力;同日Qwen3-VL-Rerank模型宣布降价。9月中旬,智能体安全中心、OpenAgent、AI建站万小智、企业AI员工AgentOne、智能体沙箱等多款智能体产品集中宣布商业化。
9月22日,2026云栖大会在杭州开幕,构成本月核心事件。阿里CEO吴泳铭现场披露正训练5万亿至10万亿参数规模的新一代模型;Qwen负责人刘大一恒宣布基于下一代架构的Qwen4已投入训练,后续Qwen4.5、Qwen5将扩展至5—10万亿参数量级。大会还披露Qwen3.8-Max已实现递归式自我改进(RSI),在人类几乎零参与下自主完成33轮迭代,ARC-AGI得分从40提升至45。平头哥同步发布新一代AI芯片真武V900,算力为前代M890的3倍,单集群可扩展至50万卡。阿里还提出2032年全球运营数据中心容量超20GW的目标,并预告下一代视频生成模型将于11月发布。
DeepSeek:V4.1 Flash开源发布,KV Cache压缩大幅压低推理成本
9月10日,DeepSeek正式发布DeepSeek V4.1 Flash,这是其全新架构系列中尺寸最小的成员。该模型为552B参数MoE架构,采用全新Causal-Encoder-Decoder非对称结构,输入激活仅8B、输出激活16B,推理成本显著低于同尺寸模型。模型原生支持多模态视觉理解,性能超越包括DeepSeek V4 Pro在内的一众旗舰模型,GPQA Diamond基准达90分以上。
最突出的技术亮点是KV Cache压缩:长文本缓存硬盘占用暴降88%,HBM需求降至上一代四分之一,SSD需求降至八分之一。预训练数据规模达45T tokens。模型权重以MIT协议在HuggingFace和ModelScope同步开源,技术报告一并放出。API定价极具冲击力:缓存命中价低至0.02元/百万tokens,未命中1.0元,输出4.0元。
9月14日起,原deepseek-v4-pro接口请求统一路由至V4.1 Flash并按Flash计价,标志着Flash正式接棒成为默认主力模型。DeepSeek App同步完成升级,整合快速、专家和识图三种模式。
360:智能体规模化落地提速,联手昇腾攻坚Agent基础设施
9月,360延续“All in Agent”主基调,把7月发布的企业智能体工作平台纳米Work推向线下与算力协同两端。9月7日,IDC发布《2026年IDC中国AI50强》榜单,360与阿里云、百度、腾讯云、小米等共同登榜,获评企业级智能体与AI安全全栈布局。9月16日,360亮相CCS 2026,披露以自研安全基座大模型与智能体蜂群为底座,纳米Work、纳米大片流水线、图龙锋及仪天阵安全智能体已形成协同矩阵,并提出“米字型人才”培养路径。9月17日,在上海华为全联接大会2026上,360与昇腾AI联合发布智能体基础设施协同方案,以360智能体工厂对接昇腾算力,面向复杂任务执行、多智能体协作与长链路推理提速,系WAIC联合展示后的深化落地。同日,周鸿祎在北京798出席2026北京艺术与科技周开幕式,宣布纳米Work启动“双城千店上岗计划”,以京沪为首站推进实体商业场景AI上岗。此外,纳米APP于9月初完成版本更新,多智能体蜂群已可拉通DeepSeek-R1/V3等16位知名大模型组成群聊,自动分工生成视频、报告与PPT。
百度:秒哒商单平台打通商业链路,文心迭代重回第一梯队成战略目标
9月百度在大模型基础研究层面无重大新模型发布,主要动作集中在AI产品商业化与生态建设。9月8日,36氪报道百度财报电话会中,李彦宏明确表态“有信心加快AI迭代,让文心重回基础大模型的第一梯队”,被外界视为百度对当前文心模型竞争力的公开正视与追赶信号。
9月11日,百度AI Day·秒哒专场在杭州举行,发布行业首个无代码应用商单平台,连接企业需求方与OPC创作者,正式打通无代码应用商业链路。同步升级“筑梦计划”,未来三年计划撮合1亿元无代码应用成单价值。秒哒企业版同步推出一键私有化部署、组织权限管理、团队共创等企业级能力。据沙利文报告,秒哒以33.4%市场份额位居国内AI原生无代码应用生成平台第一。
9月24日,百度搭子与英特尔推进端云协同,本地Skill专区正式上线,强化端侧AI能力。9月30日,雷峰网发文探讨百度在AI办公“上下文战争”中的布局思路。整体来看,百度9月重心在应用层商业化落地,基础大模型迭代处于蓄力阶段,暂未披露下一代文心模型的具体时间表。
智谱:50亿美元再融资落地,年末ARR指引上调至30亿美元
9月,作为“全球大模型第一股”的智谱(2513.HK)在资本与产品两端密集落地。9月11日,公司披露完成总额约50亿美元股债再融资,资金主要用于算力扩容。9月16日,智谱面向分析师与投资人举行电话交流会,管理层称算力供给已不再是收入增长主要约束,并将2026年末年度经常性收入(ARR)指引由24亿美元上调至30亿美元,增幅约25%;截至9月上半月,全业务口径月度ARR已达18亿美元。会上披露,智谱已与多家国内外头部云服务商签署收入分成协议,GLM开源模型将以托管API形式在海外云平台提供服务,相关收入自10月起确认;Co-work业务订单已突破十亿元。9月18日午间,智谱官方公众号宣布上线GLM-5.3-FlashX,API同步全面开放,新版本推理速度最高达200 Tokens/s,较GLM-5.3-Flash提升5倍,定价为原版本2.5倍。需要说明的是,FlashX并非新权重模型,而是Flash的提速档位,接口与GLM-5.3一致、支持1M上下文。券商方面,里昂维持“跑赢大市”评级。
小米:MiMo-V2.6系列开源发布,人车家AI全栈终端密集落地
9月是小米AI大模型“模型—系统—终端”三层集中兑现的一个月。9月7日,小米秋季旗舰发布会举行,雷军发布小米18 Fold与平板9 Pro Max,新机首次将自研玄戒O3 AI处理器、澎湃OS 4与MiMo端侧大模型三大自研集结于同一终端;澎湃OS 4上由MiMo驱动的超级小爱2.0打通手机、平板、汽车与家居跨设备协同。9月17日,MiMo团队负责人罗福莉在社交平台晒出MiMo-V2.6实时训练页面,披露其正处强化学习中间阶段,Pro与Flash两版本累计训练成本已超135万美元。9月22日,小米正式发布并开源Xiaomi MiMo-V2.6系列,含面向复杂编程与Agent任务的Pro、主打效率成本平衡的Flash,并预告同智力水平输出速度提升20倍的UltraSpeed;MiMo Desktop结束公测迎来正式版,模型同步登陆小米AI Studio、MiMo Code、MiMo API及OpenRouter。9月23日,小米18 Pro/Pro Max发布,超级小爱2.0新增AI键、可自主调用超260个系统工具,完成旅行规划、跨设备取文件等复合任务,以端侧运行为主兼顾速度与隐私。
字节跳动:Seed 2.1 Pro版本升级,火山引擎模型矩阵持续扩容
9月字节跳动在大模型领域以版本迭代和商业化落地为主,无全新架构模型发布。
9月16日,火山引擎宣布Doubao-Seed-2.1-pro更新至0915版本,API全量上线火山方舟。本次升级围绕企业生产级需求展开:Agent专业任务交付更可靠,多模态Coding能力强化,多模态理解覆盖3D与专业图文场景,同时Token效率优化带动综合使用成本下降。该模型在豆包工作内同步完成升级。
9月22日,doubao-seed-evolving深度思考模型发布版本更新,Agent长程任务执行与异步子任务验收更可靠,多模态理解效率提升,深度调研和工具执行可信度增强,Office办公跨应用协同及Coding工程实践能力进一步提升。
9月23日,火山方舟集中上线doubao-seed-2.1-pro、doubao-seed-2.1-lite、doubao-seed-2.0-mini及deepseek-v4.1-flash等多款模型;Seedance 2.5同步上线样片模式,支持先生成480P预览样片再生成高质量成片。整体来看,字节9月延续“模型+云+应用”协同推进节奏,重点在企业级生产场景打磨交付可靠性。
商汤:日日新U1 Pro正式版交付,小浣熊移动端与企业级标杆并进
9月,商汤围绕生成式AI收入占比近八成的结构继续推进产品化交付。9月11日,商汤AI办公智能体“小浣熊”移动端App正式上线,覆盖iOS与安卓双平台,支持语音交互、长按说话输入,用户可在手机端查看、分享并继续处理办公成果。9月22日,旗舰图片创作模型SenseNova U1 Pro正式版上线商汤小浣熊及日日新API服务,区别于7月WAIC期间的邀测预览版,正式版围绕“交付”目标构建从理解需求、搜索补全、设计生成到编辑自检的完整智能创作管线,通过图文交错思维链产出生产可用的图片素材,最高支持8K输出。同期,轻量化多模态模型日日新U1.5 Lite接入SenseNova Token Plan。9月28日,全球咨询机构Omdia发布《Global Enterprise-Grade Agentic Worker – China Market 2026》,对30余家厂商评估后将商汤小浣熊Work列为通用型企业AI办公标杆。商汤绝影智驾业务本月公开信息中未见重大新发布或新合作披露,中期业绩交流中预告的更大规模多模态智能体SenseNova 6.8-Flash尚未在9月亮相。
阶跃星辰:Step 5 Preview旗舰跃升,跻身全球开源前三
9月20日,阶跃星辰跳过Step 4直接发布新一代旗舰基模Step 5 Preview。模型采用稀疏MoE架构,总参数600B、单次激活约27B,原生支持文本、图片与视频输入,上下文1M tokens、单次输出64K,面向AI编程、软件工程、专业知识工作、金融及长程Agent任务。在Artificial Analysis智能指数中得分44,跻身全球开源模型前三,与2.8万亿参数的Kimi K3持平,仅落后GLM-5.3与Claude Opus 5各1分。定价输入每百万token 1美元、输出2.7美元,输出速度约100 token/s,官方称单任务成本约为Opus 5的八分之一;API发布当日全量开放,完整权重定于10月15日开源。同期上线的Step Plan订阅服务(接入Claude Code、Cursor、Trae、OpenClaw,档位49–699元)数日后各档套餐一度售罄,新用户完成首次调用可获30天免费使用权。此外,9月9日工商信息显示阶跃星辰入股半导体企业芯纪微。
京东:JDD大会锚定物理AI,JoyAI世界模型登顶开源榜
9月9日,京东在北京举办JDDiscovery 2026,以“JoyAI·跃迁物理世界”为主题,启动“物理AI加速计划”,建设“全球最大物理世界运营中心”。模型层,京东发布并开源实时可交互音视频世界模型JoyAI-Echo WM,在WBench Navigation评测中以81.6分位列全球第一(一致性89.8),超越LongBot-World、HY-World;同步升级的JoyAI-Echo 1.5长视频生成突破10分钟。京东已形成覆盖多模态、世界模型与具身模型的JoyAI基模矩阵,物流“超脑”3.0、工业JoyIndustrial 2.0、健康京医千询等垂直模型同步亮相,具身智能在物流多任务场景执行成功率96.7%。算力与数据侧,京东云联合摩尔线程等建成国产万卡集群并规划十万卡,推进1000万小时具身数据采集,首批开源数据集EgoLive已获8国百所高校申请。应用侧,京东APP 16.0发布,AI购物助手“东东”融入消费全链路;京东外卖本月推出骑手AI智能头盔。
原创文章,作者:志斌,如若转载,请注明出处:http://www.damoai.com.cn/archives/19297