从模型量化到服务部署:使用LLMCompressor实现Qwen3-8B的高效推理优化-demo-附整合包

👁️浏览: 0 🕒上传: 2026-06-30 07:24:00
☁️ 进入网盘

文件信息

📝
文件名称
从模型量化到服务部署:使用LLMCompressor实现Qwen3-8B的高效推理优化-demo-附整合包
📊
文件大小
8.35 MB
📄
文件状态
有效
🗂️
存储位置
夸克网盘
👤
分享者
小狗*吧

📁 从模型量化到服务部署:使用LLMCompressor实现Qwen3-8B的高效推理优化-demo-附整合包资源包内容详情 (8.35 MB)

从模型量化到服务部署:使用LLMCompressor实现Qwen3-8B的高效推理优化-demo-附整合包 - 文件信息

上一篇 下一篇
下载已开始