Qwen · 永久档案Qwen3-32B关注对内存要求更高,适合大内存设备与高显存 GPU。模型类型文本 · 推理总参数32.8B原生上下文32768 tokens许可证Apache-2.0发布日期2025-04-29常见精度BF16 / Q8_0 / Q4_K_M语言多语言,以官方模型卡为准推理框架llama.cpp / Ollama / MLX;按格式选择官方模型卡与下载查询适合的设备真实配置实测暂无足够实测理论内存估算不等于真实运行速度。欢迎提交完整配置。分享实测有帮助 收藏 分享举报
讨论 0