AI相关

在windwos 11 操作系统上部署vllmcpp及运行Qwen3.5-9B

在Windows11上结合你已下载的llama-b9305-bin-win-cuda-13.1-x6(llama.cpp的WindowsCUDA版本)部署该模型,你可以按照以下步骤来下载模型文件并运行:第一步:下载模型文件你需要下载两个文件:主模型文件(.gguf)和多模态视觉投影文件(mmproj...gguf,因为这是一个视觉/多模态模型)。打开浏览器,进入HuggingFace页面:http


在 Windows 11 上结合你已下载的 llama-b9305-bin-win-cuda-13.1-x6(llama.cpp 的 Windows CUDA 版本)部署该模型,你可以按照以下步骤来下载模型文件并运行:

第一步:下载模型文件

你需要下载两个文件:主模型文件(.gguf)和多模态视觉投影文件(mmproj...gguf,因为这是一个视觉/多模态模型)。

  1. 打开浏览器,进入 Hugging Face 页面:https://huggingface.co/unsloth/Qwen3.5-9B-GGUF

  2. 点击页面上方的 Files and versions 选项卡。


  3. 下载主模型: 在列表中找到 Qwen3.5-9B-UD-Q4_K_XL.gguf(或者根据你的显存大小选择其他量化版本,通常 Q4_K_M 或 Q4_K_XL 兼顾了速度和效果)。点击它右侧的下载箭头(download)图标保存到本地。

  4. 下载视觉组件: 同样在列表中找到 mmproj-F16.gguf,点击下载到本地。

提示: 如果浏览器下载很慢,可以使用下载工具(如 IDM),或者在安装了 Git 和 Git-LFS 的情况下,使用命令 git clone https://huggingface.co/unsloth/Qwen3.5-9B-GGUF 直接克隆整个仓库(但这样会把所有量化版本都下下来,占用空间极大,不建议初学者使用)。


第二步:整理文件路径

建议你建立一个专门的文件夹来存放这些文

原创不易,完成人机校验,阅读全文

相关推荐