Qwen3-Omni-30B-A3B-Instruct
Qwen/Qwen3-Omni-30B-A3B-Instruct
官方 · BF16 · safetensors
已验证运行环境: Transformers
| 精度 / 量化 | 格式 | 位数 | 发布者可信度 | 部署状态 |
|---|---|---|---|---|
| BF16 | safetensors | 16 | 官方 | 已验证运行环境 |
Qwen3-Omni 30B-A3B Instruct 是 Qwen 在 Qwen 全模态分支中的官方可自托管版本,采用 Qwen3OmniMoeForConditionalGeneration、30B / 3B MoE,认证上下文为 32,768 词元。
Qwen3-Omni 30B-A3B Instruct 使用 Qwen3OmniMoeForConditionalGeneration 和 30B / 3B MoE。官方资料发布时记录 64 层、隐藏维度 8192 和 64 个注意力头。
仅显示与此版本关联并经来源认证的精确变体。
Qwen/Qwen3-Omni-30B-A3B-Instruct
官方 · BF16 · safetensors
已验证运行环境: Transformers
| 精度 / 量化 | 格式 | 位数 | 发布者可信度 | 部署状态 |
|---|---|---|---|---|
| BF16 | safetensors | 16 | 官方 | 已验证运行环境 |
仅使用与精确检查点精度匹配的认证运行时组合。硬件排序会检查权重、KV 缓存、开销、GPU 架构与拓扑。
推荐性价比方案
160 GB 总 VRAM · nvlink
67.01 GB 余量 · 可用
USD 1,830 / 月最低成本可行方案
96 GB 总 VRAM · pcie
3.01 GB 余量 · 可用
USD 1,000 / 月最高性能
160 GB 总 VRAM · nvlink
67.01 GB 余量 · 可用
USD 1,830 / 月全部 30 B 常驻权重必须装入所选 GPU;上下文与并发会增加 KV 缓存。
Qwen3-Omni 30B-A3B Instruct 采用 Apache 2.0 许可证 发布,并保留版本级官方 URL 与验证日期。
允许商业使用. 官方许可允许商业使用,但仍须遵守其全部义务。
千问3-Omni-30B-A3B-Instruct
估算取决于精度、上下文和并发,并使用认证数据。
transformers 已有认证的上游证据。
存储分类为允许商业使用;请查阅官方 Apache 2.0 许可证 条款。
最近验证: 2026-08-26