Back to News

Alibaba's Qwen AI platform adds agent services, industry solutions, API fast mode

#alibaba#qwen#ai-platform#agent

At the 2026 Apsara Conference, Alibaba announced a comprehensive upgrade of its Qwen AI platform, adding agent services and industry AI solutions alongside model services, with new capabilities including API fast mode, Agent Studio, and a cockpit solution. The company also projected its cloud computing capacity to exceed 20GW by 2032, and reported a sixfold increase in MaaS platform customers over the past year.

Coverage timeline

  1. 机器之心新闻资讯

    9月22日,在2026云栖大会MaaS & Agent技术主论坛上,阿里巴巴集团战略副总裁、ATH事业群MaaS业务线总裁文征宣布千问AI平台全面升级:以推动Agent进入生产作为建设核心,在模型服务基础上新增对Agent服务、行业AI解决方案的支持,并推出了API优速模式、Agent Studio、千问AI座舱解决方案等一系列能力,帮助企业将智能转化为生产力。 从消耗Token到交付结果,AI价值的衡量方式正在改变 文征表示,AI仍处于非常早期的阶段,用户覆盖、场景渗透和算力规模均有巨大增长空间。持续增长的Token用量说明,AI需求已不再是一道需要证明的题,关键在于谁能将智能转化为结果。单任务价值、Token生产效率和单Token能力,共同决定“智能价值密度”。 过去一年,阿里云MaaS平台服务的客户数增长六倍。随着订单、代码、内容和业务流程主动发起调用,Agent开始进入企业核心流程,企业需要的不再只是一个模型API,而是一套覆盖模型供给、生产运行、Agent构建与托管的完整体系。智能正在从被调用走向被交付。 需求的持续放大,对算力和基础设施提出了更高要求。阿里将坚定投入全栈AI,预计到2032年,阿里云运营的算力规模将超过20GW,支撑从芯片、AI基础设施,到千问大模型、模型服务、Agent工具和AI原生应用的完整AI体系,加速Agent时代的产业进化。 面向Agent负载持续完善模型服务 在模型供给方面,千问AI平台以“First and Best”原则,支持全球一流的自研和开放模型第一时间上线。针对Agent决策链路长、并发高、对时延敏感等特点,平台通过FlashBoot、UniScheduler等能力调度异构算力,将模型弹性启动时间由1200秒缩短至70秒,可在1分钟内拉起1万个Pods;首Token延迟降低38%,Prompt Caching成本最高节省95%。 平台提供99.9%生产级SLA、十亿级单客户峰值TPM和CMaaS机密推理服务,支持监控、告警和成本治理。本次升级的API优速模式可将TPS提升1.5至2倍,用户切换model ID即可使用;吞吐预留(PTU)新增夜间8小时预留规格;独占吞吐(DTU)则面向大型企业及金融、政企客户,支持定制模型部署与性能定制。 在服务模式上,Token Plan以一份订阅覆盖 Qwen、Kimi、GLM、D