
千问云是什么?
千问云(Qwen Cloud)是阿里云于2026年5月20日在阿里云峰会上正式发布的全新AI产品官网,定位为"为Agent而生的全栈智能基础设施"。平台聚合了150余个模型系列、480余款主流模型API,覆盖Qwen、GLM、Kimi、DeepSeek、Wan、HappyHorse等国内外主流大模型。核心创新在于将模型选型、调用、认证配置、用量查询等全链路能力封装为Skills和CLI工具,Agent无需人工编写集成代码,仅凭一句指令即可自主完成模型调用与AI应用开发,Skills和CLI工具已在GitHub开源。
千问云官网地址为 https://www.qianwenai.com/
产品核心定位:“为AI Agent而生的全栈智能基础设施”(MaaS——模型即服务平台)。
阿里云资深副总裁刘伟光在发布会上明确表示:“过去模型服务平台为人服务,未来用模型的主力将是Agent。” 千问云正是围绕这一判断,从原子能力到交互逻辑实现了全面重构。
与传统的模型服务平台(以人类操作为核心设计)不同,千问云采用Agent-Friendly设计理念,将模型服务的全部能力封装为Agent可理解、可调用的技能组合,实现了从"人用模型"到"Agent用模型"的范式转变。
核心功能
1. 480+模型API聚合
千问云已上架150余个模型系列、480余款各类模型,覆盖国内外主流开源与闭源模型,包括:
| 模型系列 | 代表型号 | 能力方向 |
|---|---|---|
| Qwen | Qwen3.6-Max | 旗舰推理,高难复杂任务 |
| DeepSeek | DeepSeek-V4-Flash | 轻量MoE专家,极速普惠 |
| GLM | GLM-5.1 | 长程任务专家,深虑广识 |
| Kimi | Kimi-K2.6 | 码图文视,全能旗舰 |
| HappyHorse | HappyHorse-1.0 / I2V | 原生音画协同视频生成 |
| Wan | Qwen-Image-2.0-Pro | 细腻真实质感图片生成 |
| CosyVoice | — | 克隆音色,实时语音合成 |
平台支持多模型并行体验与横向对比,用户可直接查看不同模型在参数、能力、价格、上下文长度、模态支持、适用场景等维度的对比信息,一键跳转体验页面用真实Prompt验证输出效果。
2. Skills技能包——Agent一句话调用
千问云将模型选型、调用及用量查询等能力封装为Skills,Agent无需阅读文档、编写代码或调试API参数,仅凭一句简单指令,OpenClaw、HermesAgent、Claude Code、Qoder等智能代理便能"掌握"千问云的全部能力并一键调用。
安装方式:
code复制
npx skills add QianWen-AI/qianwen-ai
3. CLI命令行工具——全自动化工作流
千问云提供稳定、可重复、可自动化的CLI命令行入口,覆盖登录认证、模型查询、环境诊断、状态查询等能力,支持人与Agent通过脚本自动化完成所有模型服务的工作流。
安装方式:
code复制
npm install -g @qianwenai/qianwen-cli
4. 智能用量管理
Agent可实时拉取模型用量数据,分析趋势、识别异常、辅助成本优化;用户可通过CLI拉取日志、Key活动等数据,实现异常识别与任务全链路追溯。
5. Token Plan订阅制
千问云推出Token Plan订阅模式,采用多模型兼容架构与按月订阅、用量可控的弹性计费方式,面向高频AI编程与Agent工具使用场景提供高性价比服务,订阅制低至6折。
6. 多模态能力矩阵
| 场景 | 能力说明 |
|---|---|
| 图片与视频创作 | 依托万相多模态能力,支持文生图、文生视频、图生视频及人声生视频,影视级画面把控与音画同步 |
| 陪伴与社交 | 集成千问大模型实时交互、文字翻译、物体识别,支持虚拟IP打造与实时情感化对话 |
| 智能座舱 | 集成出行助手、智能规划、智能推荐、长期记忆,构建智能出行新体验 |
7. 一个API Key全模态通行
订阅即享高级模型权限,一个API Key即可访问全部模型,兼容主流AI工具。
技术架构特点
Agent-Friendly设计理念
千问云从架构层面贯彻"智能体友好"原则,将模型选型、调用执行、用量查询等核心能力统一封装为结构清晰、语义明确、可被智能体直接理解与调用的技能模块。
MCP(模型上下文协议)化
千问云实现全站MCP化重构,允许智能体根据任务动态路由——自动调用视觉大模型处理图片,或转接生图大模型进行插画处理,无需人工干预。
"芯-云-模型-推理"全栈体系
千问云是阿里云全新"芯-云-模型-推理"技术体系的重要组成部分,从底层算力到上层应用全链路就绪。
GitHub开源
千问云的Skills和CLI工具已在GitHub开源,开发者可自由查看、贡献和定制。
适用人群
| 角色 | 核心用法 |
|---|---|
| AI应用开发者 | 480+模型一键调用,快速完成选型评估 |
| Agent开发者 | Skills/CLI一键集成,Agent自主调用模型 |
| 企业AI团队 | Token Plan订阅控成本,用量透明可追溯 |
| 独立开发者 | 低门槛接入,一个API Key全模态通行 |
| AI编程用户 | 高频编程场景订阅低至6折 |
AITOP100作为华强方特(深圳)动漫有限公司倾力打造的AI数智化聚合营销平台,同时也作为全网最全AI大赛活动举办和收录平台以及国内AI头部社区之一,平台已收录超700场AI视频、绘画、写作、算法等大赛。更有AI工具、资讯、教程、大咖直播。承办线上线下活动。快来参与或合作!
官网:https://www.aitop100.cn
想了解AITOP100平台其它版块的内容,请点击下方超链接查看
AI创作大赛 | AI活动 | AI工具集 | AI资讯专区 | AI小说
AITOP100平台官方交流社群二维码:


评论
全部评论

暂无评论
热门推荐
相关推荐

九章大模型MathGPT
学而思九章大模型(MathGPT)作为国内首个教育领域千亿参数大模型以及首批通过备案的教育大模型,宛如一颗璀璨新星,照亮了智慧教育前行的道路。它的诞生,不仅是技术的突破,更是教育理念与先进科技深度融合的结晶。接下来,让我们一同深入探索这一具有划时代意义的大模型。
Fabric 1.0
VEED Fabric 1.0是VEED.IO 推出的全球首款AI会说话视频模型,它实现了从静态图像到动态叙事的重大跨越,仅需一张图片结合语音输入,就能生成最长1分钟、具备逼真唇形同步和自然面部表情的会话视频。该模型专为“talking head”视频设计,生成速度极快,成本大幅降低,还集成多种生态
Sonic-3
Sonic-3是美国生成式AI公司Cartesia推出的第三代实时文本转语音(Real-time TTS)模型。它基于自研的State-Space序列架构,在保持极低保真延迟最低90ms的同时,首次在公开API中实现了情绪标签驱动的笑声、呼吸、停顿与多情感强度控制,被业内称为会笑会喊的大语言模型。
EVI3
EVI3是Hume公司在2025年5月29日正式发布全新语音语言模型,这一创新标志着通用语音智能领域进入的发展阶段。作为全球首个突破传统文本到语音(TTS)技术框架的语音到语音(V2S)模型,EVI3不仅重新定义了语音交互的边界,更通过多模态情感计算能力为AI语音技术树立了新的技术标杆。
Ming-Omni
Ming-Omni是由Inclusion AI与蚂蚁集团联合推出的开源多模态模型,其核心亮点在于统一处理图像、文本、音频和视频,并支持语音与图像生成,成为首个在模态支持能力上与GPT-4o媲美的开源模型。
Vidi
Vidi是字节跳动推出的一款全新多模态模型,它专注于视频理解与编辑领域,旨在通过融合视觉、音频和文本等多种模态信息,为用户提供精准、高效的视频处理解决方案。Vidi不仅能够处理长达一小时的超长视频,还能在时间检索和多模态协同处理方面展现出卓越的性能。
天工AI大模型
昆仑万维天工AI大模型是昆仑万维集团自主研发的一系列大型语言模型(LLMs),旨在通过先进的自然语言处理和深度学习技术,为用户提供高效、智能的服务和体验。该系列模型不仅具备强大的语言理解和生成能力,还广泛应用于教育、企业客服、新闻媒体、创意产业、医疗、法律咨询、金融服务等多个行业。
Magma AI
Magma是一款由微软精心打造的多模态AI模型,它旨在处理和整合图像、文本和视频等多种数据类型。与传统的AI系统不同,Magma不仅仅专注于视觉-语言理解或机器人操作等单一领域,而是将这两种能力结合成一个统一的模型,使得AI代理能够在数字和物理环境中执行更为复杂的任务。
0
0






