9月22日,在2026云栖大会MaaS&Agent技术主论坛上,阿里巴巴集团战略副总裁、ATH事业群MaaS业务线总裁文征宣布千问AI平台全面升级:以推动Agent进入生产作为建设核心,在模型服务基础上新增对Agent服务、行业AI解决方案的支持,并推出了API优速模式、AgentStudio、千问AI座舱解决方案等一系列能力,帮助企业将智能转化为生产力。

AI价值的衡量方式正在改变
文征表示,AI仍处于非常早期的阶段,用户覆盖、场景渗透和算力规模均有巨大增长空间。持续增长的Token用量说明,AI需求已不再是一道需要证明的题,关键在于谁能将智能转化为结果。单任务价值、Token生产效率和单Token能力,共同决定“智能价值密度”。
过去一年,阿里云MaaS平台服务的客户数增长六倍。随着订单、代码、内容和业务流程主动发起调用,Agent开始进入企业核心流程,企业需要的不再只是一个模型API,而是一套覆盖模型供给、生产运行、Agent构建与托管的完整体系。智能正在从被调用走向被交付。
需求的持续放大,对算力和基础设施提出了更高要求。阿里将坚定投入全栈AI,预计到2032年,阿里云运营的算力规模将超过20GW,支撑从芯片、AI基础设施,到千问大模型、模型服务、Agent工具和AI原生应用的完整AI体系,加速Agent时代的产业进化。
面向Agent负载持续完善模型服务

在模型供给方面,千问AI平台以“FirstandBest”原则,支持全球一流的自研和开放模型第一时间上线。针对Agent决策链路长、并发高、对时延敏感等特点,平台通过FlashBoot、UniScheduler等能力调度异构算力,将模型弹性启动时间由1200秒缩短至70秒,可在1分钟内拉起1万个Pods;首Token延迟降低38%,PromptCaching成本最高节省95%。
平台提供99.9%生产级SLA、十亿级单客户峰值TPM和CMaaS机密推理服务,支持监控、告警和成本治理。本次升级的API优速模式可将TPS提升1.5至2倍,用户切换modelID即可使用;吞吐预留(PTU)新增夜间8小时预留规格;独占吞吐(DTU)则面向大型企业及金融、政企客户,支持定制模型部署与性能定制。
在服务模式上,TokenPlan以一份订阅覆盖Qwen、Kimi、GLM、DeepSeek等多类模型,原生打通Qoder、Cursor、Codex、OpenClaw等主流编程工具与Agent框架,并可与千问App、千问办公共享抵扣。结合按量付费、优速模式、吞吐预留与独占吞吐,从个人到企业的各类需求均可在同一平台获得对应供给。
AgentStudio发布,提供企业级全栈Agent服务
从模型调用到业务结果,Agen需要模型匹配、任务运行、上下文接入和服务调用等基础能力。千问AI平台正式发布企业级全栈Agent服务平台AgentStudio,可根据任务自动路由选择模型,提供24小时不间断托管运行,并支持企业内部知识数据和外部软件服务接入。
平台提供99.9%生产级SLA、十亿级单客户峰值TPM和CMaaS机密推理服务,支持监控、告警和成本治理。本次升级的API优速模式可将TPS提升1.5至2倍,用户切换modelID即可使用;吞吐预留(PTU)新增夜间8小时预留规格;独占吞吐(DTU)则面向大型企业及金融、政企客户,支持定制模型部署与性能
定制。
在服务模式上,TokenPlan以一份订阅覆盖Qwen、Kimi、GLM、DeepSeek等多类模型,原生打通Qoder、Cursor、Codex、OpenClaw等主流编程工具与Agent框架,并可与千问App、千问办公共享抵扣。结合按量付费、优速模式、吞吐预留与独占吞吐,从个人到企业的各类需求均可在同一平台获得对应供给。
AgentStudio发布,提供企业级全栈Agent服务从模型调用到业务结果,Agen需要模型匹配、任务运行、上下文接入和服务调用等基础能力。千问AI平台发布企业级全栈Agent服务平台AgentStudio,可根据任务自动路由选择模型,提供24小时不间断托管运行,并支持企业内部知识数据和外部软件服务接入。
文征认为,平台的价值不是定义所有应用,而是让更多应用生长出来。只有将模型服务、Agent服务、AI原生应用和行业实践连成体系,智能才能从通用能力走向产业生产力。
目前,相关模型服务和Agent能力已在千问AI平台上线。开发者可通过API完成产品集成或订阅TokenPlan,在已支持的常用AI工具中直接调用相应模型和服务。