← 返回模型
Qwen · 永久档案

Qwen3-32B

对内存要求更高,适合大内存设备与高显存 GPU。

模型类型
文本 · 推理
总参数
32.8B
原生上下文
32768 tokens
许可证
Apache-2.0
发布日期
2025-04-29
常见精度
BF16 / Q8_0 / Q4_K_M
语言
多语言,以官方模型卡为准
推理框架
llama.cpp / Ollama / MLX;按格式选择
官方模型卡与下载查询适合的设备

真实配置实测

暂无足够实测
理论内存估算不等于真实运行速度。欢迎提交完整配置。
分享实测

讨论 0

友善交流,理性求证