Qwen3-8B-AWQ
官方 · AWQ · safetensors
| 精度 / 量化 | 格式 | 位数 | 发布者可信度 | 部署状态 |
|---|
Qwen3-8B-AWQ 是 Qwen 在 Qwen 通用分支中的官方可自托管版本,采用制造商未发布、制造商未发布,认证上下文为 0 词元。
Qwen3-8B-AWQ 使用制造商未发布和制造商未发布。官方资料发布时记录 N/A 层、隐藏维度 N/A 和 N/A 个注意力头。
仅显示与此版本关联并经来源认证的精确变体。
官方 · AWQ · safetensors
| 精度 / 量化 | 格式 | 位数 | 发布者可信度 | 部署状态 |
|---|
仅使用与精确检查点精度匹配的认证运行时组合。硬件排序会检查权重、KV 缓存、开销、GPU 架构与拓扑。
商业权利尚未核实,因此不建议用于商业部署。
全部 0 B 常驻权重必须装入所选 GPU;上下文与并发会增加 KV 缓存。
Qwen3-8B-AWQ 采用 Not officially published 发布,并保留版本级官方 URL 与验证日期。
未知 / 不建议部署. 商业权利尚未核实,因此不建议用于商业部署。
千问3.8-27B, 千问3-8B, 千问3.8-2.4T-A95B, 千问3-30B-A3B-Instruct-2507, 千问3-235B-A22B, Qwen3.8-2.4T-A95B-NVFP4, ContextPilot-8B, Qwen3.8-27B-FP8, Qwen3.8-2.4T-A95B-FP8, tmax-sft-8b, WebWorld-14B, WebWorld-32B, WebWorld-8B, intent-aware-lfqa-qwen3-8b-intent-implicit, intent-aware-lfqa-qwen3-8b-baseline, intent-aware-lfqa-qwen3-8b-multiview, intent-aware-lfqa-qwen3-8b-intent-explicit, MolmoWeb-Pretrained-8B, MolmoWeb-4B, MolmoWeb-8B, MolmoWeb-4B-Native, MolmoWeb-8B-Native, MolmoWeb-Pretrained-4B, MolmoPoint-8B, Penguin-VL-8B, Qwen3-235B-A22B-Eagle3, Molmo2-8B, Qwen3-8B-DMS-8x, WeDLM-8B-Base, Qwen3-Nemotron-8B-BRRM, Nemotron-Orchestrator-8B, Qwen3Guard-Gen-8B, Qwen3Guard-Stream-8B, Qwen3-30B-A3B-Instruct-2507-FP8, Qwen3-8B-FP8, Qwen3-8B-NVFP4, cudaLLM-8B, Qwen3-235B-A22B-FP8, Qwen3-235B-A22B-NVFP4, Qwen3-8B-GGUF, Qwen3-235B-A22B-GGUF, Qwen3-235B-A22B-GPTQ-Int4, Qwen3.8 2.4T-A95B, Qwen3.8 27B, Qwen3 30B-A3B Instruct 2507
估算取决于精度、上下文和并发,并使用认证数据。
制造商未发布已有认证的上游证据。
存储分类为未知 / 不建议部署;请查阅官方 Not officially published 条款。
最近验证: 2026-09-03