PAI Model Gallery 支持云上一键部署 Qwen3 全尺寸模型

2025-04-29 15:47 作者：Kathy 来源：硅谷网综合关注：编辑：GuiGu 【搜索试试】

模型简介

Qwen3 是 Qwen 系列最新一代的大语言模型，提供了一系列密集（Dense）和混合专家（MOE）模型。基于广泛的训练，Qwen3 在推理、指令跟随、Agent 能力和多语言支持方面取得了突破性的进展，具有以下关键特性：

独特支持在思考模式（用于复杂逻辑推理、数学和编码）和 非思考模式（用于高效通用对话）之间无缝切换，确保在各种场景下的最佳性能。

显著增强的推理能力，在数学、代码生成和常识逻辑推理方面超越了之前的 QwQ （在思考模式下）和 Qwen2.5 指令模型（在非思考模式下）。

卓越的人类偏好对齐，在创意写作、角色扮演、多轮对话和指令跟随方面表现出色，提供更自然、更吸引人和更具沉浸感的对话体验。

擅长 Agent 能力，可以在思考和非思考模式下精确集成外部工具，在复杂的基于代理的任务中在开源模型中表现领先。

支持 100 多种语言和方言，具有强大的多语言理解、推理、指令跟随和生成能力。

PAI Model Gallery 简介

Model Gallery 是阿里云人工智能平台 PAI 的产品组件，它集成了国内外 AI 开源社区中优质的预训练模型，涵盖了 LLM、AIGC、CV、NLP 等各个领域。通过 PAI 对这些模型的适配，用户可以以零代码方式实现从训练到部署再到推理的全过程，简化了模型的开发流程，为开发者和企业用户带来了更快、更高效、更便捷的 AI 开发和应用体验。

PAI Model Gallery 访问地址：https://pai.console.aliyun.com/#/quick-start/models

阿里云 PAI Model Gallery 已同步接入Qwen3本次开源的所有模型，提供企业级部署方案。

✅ 零代码一键部署

✅ 自动适配云资源

✅ 部署后开箱即用API

✅ 全流程运维托管

✅ 企业级安全数据不出域

一键部署 Qwen3 方案

⬇️ 立即体验 ⬇️

下面以 Qwen3-8B 模型部署为例（推理成本较低，可用于快速验证）。

在 Model Gallery 模型广场找到 Qwen3-8B 系列模型，或通过链接直达该模型：https://pai.console.aliyun.com/?regionId=cn-beijing#/quick-start/models/Qwen3-8B/intro

在模型详情页右上角点击「部署」，已支持SGLang、vLLM高性能部署框架。在选择计算资源后，即可一键完成模型的云上部署。

部署成功后，在服务页面可以点击“查看调用信息”获取调用的 Endpoint 和 Token，想了解服务调用方式可以点击预训练模型链接，返回模型介绍页查看调用方式说明。

使用推理服务。您可以在 PAI-EAS 推理服务平台上在线调试已部署好的 Qwen3 模型服务，从图中可以看出模型回复具备较好的思维链能力。

下表提供了部署所需的最低配置，以及使用不同机型部署时在不同推理框架上支持的最大 Token 数。

模型	支持的最大 Token 数（输入+输出）	最低配置
	SGLang 加速部署	vLLM 加速部署
Qwen3-235B-A22B	32768（加 RoPE 缩放：131072）	32768（加 RoPE 缩放：131072）	8 卡 GPU H / GU120 （8 * 96 GB 显存）
Qwen3-235B-A22B-FP8	32768（加 RoPE 缩放：131072）	32768（加 RoPE 缩放：131072）	4 卡 GPU H / GU120 （4 * 96 GB 显存）
Qwen3-30B-A3B Qwen3-30B-A3B-Base Qwen3-32B	32768（加 RoPE 缩放：131072）	32768（加 RoPE 缩放：131072）	1 卡 GPU H / GU120 （96 GB 显存）
Qwen3-14B Qwen3-14B-Base	32768（加 RoPE 缩放：131072）	32768（加 RoPE 缩放：131072）	1 卡 GPU L / GU60 （48 GB 显存）
Qwen3-8B Qwen3-4B Qwen3-1.7B Qwen3-0.6B Qwen3-8B-Base Qwen3-4B-Base Qwen3-1.7B-Base Qwen3-0.6B-Base	32768（加 RoPE 缩放：131072）	32768（加 RoPE 缩放：131072）	1 卡 A10 / GU30 （24 GB 显存）

联系我们

欢迎各位小伙伴持续关注使用 PAI-Model Gallery，平台会不断上线 SOTA 模型，如果您有任何模型需求，也可以联系我们。您可通过钉钉扫描下方二维码（或搜索钉钉群号79680024618），加入PAI-Model Gallery用户交流群。

【对“PAI Model Gallery 支持云上一键部署 Qwen3 全尺寸模型”发布评论】

版权及免责声明：
① 本网站部分投稿来源于“网友”，涉及投资、理财、消费等内容，请亲们反复甄别，切勿轻信。本网站部分由赞助商提供的内容属于【广告】性质，仅供阅读，不构成具体实施建议，请谨慎对待。据此操作，风险自担。
② 内容来源注明“硅谷网”及其相关称谓的文字、图片和音视频，版权均属本网站所有，任何媒体、网站或个人需经本网站许可方可复制或转载，并在使用时必须注明来源【硅谷网】或对应来源，违者本网站将依法追究责任。
③ 注明来源为各大报纸、杂志、网站及其他媒体的文章，文章原作者享有著作权，本网站转载其他媒体稿件是为传播更多的信息，并不代表赞同其观点和对其真实性负责，本网站不承担此类稿件侵权行为的连带责任。
④ 本网站不对非自身发布内容的真实性、合法性、准确性作担保。若硅谷网因为自身和转载内容，涉及到侵权、违法等问题，请有关单位或个人速与本网站取得联系（联系电话：01057255600），我们将第一时间核实处理。

■

相关

■

头条