Qwen3.6-35B¶
在这篇文章中
信息
Qwen3.6 是来自阿里云的开源多模态 MoE (Mixture of Experts) 模型,总参数量为 350 亿,每个 token 的激活参数量为 30 亿,旨在提高开发人员的生产力并提升在现实任务中的性能。该模型专注于稳定性和实用性,提供直观且响应迅速的体验。Qwen3.6 支持多模态输入(文本和图像),上下文窗口为 256K tokens。
Qwen3.6-35B 的关键特性¶
- MoE 结构:350 亿总参数和 30 亿激活参数,确保具有与较小模型相当的高生成速度;
- 线性注意力 (Linear Attention):采用带有 Gated DeltaNet 的混合架构,可高效处理长上下文;
- 大上下文窗口:该模型支持 256K tokens 的上下文窗口,使其能够处理长文档和复杂的多步任务而不会丢失上下文;
- 智能代理编程 (Agentic Coding):在前端工作流和仓库级推理方面有显著改进,在解决复杂的开发任务时提供更高的流畅度和准确性;
- 思维保留 (Thinking Preservation):引入了一项新功能,用于保留来自先前消息的推理上下文,这简化了迭代开发并降低了处理长期任务时的开销;
- 多模态支持:模型同时支持文本和图像输入,扩展了其在各种用例中的适用性;
- 多语言支持:与 Qwen 系列之前的模型一样,Qwen3.6 具备多语言能力。为了获得最佳效果,建议明确指定交互的目标语言。
部署功能¶
| ID | 软件名称 | 兼容操作系统 | 虚拟机 | 物理机 | vGPU | GPU | 最低CPU(核) | 最低内存(GB) | 最低硬盘(GB) | 自定义域名 | 是否启用 |
|---|---|---|---|---|---|---|---|---|---|---|---|
| 641 | Qwen3.6:35b | Ubuntu 22.04 | + | + | + | + | 8 | 12 | 40 | 否 | 订购 |
备注
除非另有说明,否则我们默认从开发者的网站或操作系统仓库安装该软件的最新发布版本。
部署 Qwen3.6-35B 后的入门指南¶
付款完成后,关于服务器就绪状态的通知将发送到注册时提供的电子邮件地址。邮件中将包含 VPS IP 地址、连接服务器的登录名和密码,以及访问 Open WebUI 面板的链接。客户可以通过 Server Control Panel and API — Invapi 来管理其硬件。
-
访问服务器操作系统的授权凭据(例如通过 SSH)将通过电子邮件发送给您。
-
访问带有 Open WebUI Web 界面的 Ollama 控制面板的链接:位于 Invapi 控制面板的 Configuration >> Tags 选项卡下的 webpanel 标签下。确切的链接格式为
https://qwen<Server_ID_from_Invapi>.hostkey.com,将在服务器交付时的电子邮件中发送。
点击来自 webpanel 标签的链接后,将打开 Get started with Open WebUI 授权窗口,您必须在此处为聊天机器人创建管理员用户名、电子邮件和密码,然后点击 Create Admin Account 按钮:

警告
在第一个用户注册后,系统会自动为其分配 Administrator 角色。为了确保安全并控制注册过程,所有后续的注册请求必须由管理员账号在 Open WebUI 界面中进行批准。
成功注册后,将打开 Open WebUI 主界面:

备注
有关如何通过 Open WebUI 使用 Ollama 控制面板的详细说明,请参阅 AI Chatbot on Your Own Server 文章。
备注
为了获得最佳性能,建议使用显存 (VRAM) 大于最低要求 24 GB 的 GPU,这为处理长上下文和并行请求提供了余量。有关 Ollama 和 Open WebUI 核心设置的详细信息,可以在 Ollama developer documentation 和 Open WebUI developer documentation 中找到。