在AMD 锐龙 AI Max 智能体PC和Radeon 显卡上运行Qwen3.8 27B模型
近日,AMD正式为Qwen3.8 27B提供Day 0支持。从模型发布首日(Day 0)起,开发者即可在基于AMD处理器的PC和工作站上本地运行这款领先的稠密模型。
Qwen3.8 27B为千问家族的最新一代模型带来了非常适合本地AI开发的模型规模。Qwen3.8系列继续专注于编程、实际工作、科研及长周期AI任务负载,进一步加速了开源AI领域的快速创新。
用户可通过llama.cpp等开源框架,将Qwen3.8 27B直接部署到搭载AMD 锐龙 AI Max+处理器或单张AMD Radeon AI PRO R9700 32GB显卡的系统上。该模型同样可运行在可变图形内存或显存大于 24GB 的受支持的AMD 硬件上。这使得开发者可以直接在同一台设备上完成应用的构建、测试与运行,而这一切在模型发布Day 0即可实现。
早期测试数据显示,Qwen3.8‑27B 在 AMD 硬件上具备优异的本地运行性能:在 AMD 锐龙 AI Max+ 395 处理器上最高可达 24.5 token / 秒;单张 AMD Radeon AI PRO R9700 显卡最高可达 51.8 token / 秒。作为一款 27B 参数稠密模型,Qwen3.8‑27B 对内存容量与算力要求较高,具备充足算力的本地硬件因此显得尤为关键。
以上初步测试结果基于 Windows 平台,采用主流开源项目 llama.cpp 搭配 Vulkan 后端测得;锐龙 AI Max+ 395 设置 MTP=4,Radeon AI PRO R9700 设置 MTP=2,取三次及以上运行的平均 token 生成吞吐速率。由于软件与模型层面的优化仍在持续推进,随着Day 0适配能力不断完善,预计性能还将进一步提升。
通过LM Studio运行模型
对于希望即刻上手使用 Qwen3.8‑27B 的高阶用户与技术爱好者,LM Studio 提供了简单便捷的本地模型运行途径。
在兼容的 AMD 设备上,用户可通过熟悉的图形化界面检索、下载并使用该模型。Qwen3.8‑27B 可在推荐 AMD 硬件上通过 LM Studio 运行,包括搭载 AMD 锐龙 AI Max+ 处理器的设备,以及 AMD Radeon AI PRO R9700 32GB 专业显卡。请注意,流畅运行该模型大约需要 24GB 可变图形内存或显存;同时该模型也可通过 LM Studio部署于其他旧款但受支持的AMD 硬件平台。
注意:为获得最佳性能,需要启用 MTP 并正确设置草稿 Token 数量。AMD 锐龙 AI Max+ 平台建议设置为 4,AMD Radeon AI PRO R9700 建议设置为 2。同时,在高级模型加载设置中取消勾选“Try mmap”。
这使得LM Studio成为探索该模型、测试提示词和工作流,以及体验Qwen3.8 27B本地能力的便捷工具——无需编写任何应用程序代码。对于 AMD 用户而言,LM Studio 是持续壮大的本地 AI 生态组成部分。该生态基于开源模型与 llama.cpp 这类广泛普及的推理技术构建,为用户提供了从模型下载到本地推理的完整便捷链路。
以Day 0首发支持推动前沿本地AI模型发展
开源 AI 领域的创新节奏从未放缓,每当有全新模型发布,用户不应被动等待硬件与软件生态跟进适配。
Qwen3.8 27B的发布,是本地AI发展的又一重要里程碑。它将新一代模型能力带到用户自己的设备上,让用户可以真正在本地运行。
AMD 锐龙 AI Max + 处理器与 AMD Radeon AI PRO R9700 显卡,为开发者提供了性能强劲的本地运行平台;LM Studio 提供快速体验该模型的途径;Lemonade 则帮助开发者将模型能力落地为实际应用。
借助 AMD 提供的Day 0首发支持,开发者自模型发布之日起即可开展开发工作。