首页/新闻资讯/正文详情

基于 Ollama 部署 qwen2.5-coder-14b(GGUF 直下版)

发布时间:2026/9/26 4:16:35 来源:云帆数科 栏目:资讯中心
基于 Ollama 部署 qwen2.5-coder-14b(GGUF 直下版)
与Ollama相关的文章可见Ollama 大模型本地部署与轻量化优化-CSDN博客操作步骤适用场景本地编码模型部署接入 opencode、Trea中 使用一、前置准备Python 虚拟环境(可选D:\venv_all可创建一个虚拟环境py 3.12 -m venv venv_all然后pip install torch transformers sentencepiece protobuf gguf官方下载地址Ollama国内镜像地址 Ollama - Ollama 框架模型下载目录D:\models\qwen2.5-coder-14b-gguf地址自行选择工具说明本次走下载官方现成 GGUF路径无需llama.cpp 的 convert/quantize 步骤三、完整操作步骤步骤 1激活虚拟环境在powershell中激活虚拟环境D:\venv_all\Scripts\Activate.ps1成功标志提示符前出现(venv_all)若报禁止运行脚本先执行Set-ExecutionPolicy -Scope Process Bypass再激活步骤 2安装下载工具 非必选项谨慎执行该命令该命令会让huggingface_hub更新为最新版本可能会与环境中的其它库包造成版本冲突python -m pip install -U huggingface_hub注新版huggingface-cli命令已废弃一律使用hf命令步骤 3设置国内镜像加速$env:HF_ENDPOINT https://hf-mirror.com步骤 4查看仓库文件列表确认档位hf download Qwen/Qwen2.5-Coder-14B-Instruct-GGUF --dry-run官方仓库文件列表确认结果2026-09-24 不同量化精度的模型文件大小qwen2.5-coder-14b-instruct-q3_k_m.gguf7.3 Gqwen2.5-coder-14b-instruct-q4_k_m-00001-of-00002.gguf8.0 G 987.7Mqwen2.5-coder-14b-instruct-q4_0.gguf8.5 Gqwen2.5-coder-14b-instruct-fp16.gguf29.5 G其余 Q2_K / Q5_K_M / Q6_K / Q8_05.8~15.7 G步骤 5下载 Q3_K_M约 7.3 GB结合自己电脑的配置内层、显卡大小选择合适的hf download Qwen/Qwen2.5-Coder-14B-Instruct-GGUF --include *q3_k_m* --local-dir D:\models\qwen2.5-coder-14b-gguf--include用小写*q3_k_m*文件名小写只匹配目标文件下载完成标准D:\models\qwen2.5-coder-14b-gguf\qwen2.5-coder-14b-instruct-q3_k_m.gguf存在且约 7.3 GB断网重跑同一条命令自动续传步骤 6写 Modelfile在D:\models\qwen2.5-coder-14b-gguf新建Modelfile-coder14b记事本编码选 UTF-8FROM D:\models\qwen2.5-coder-14b-gguf\qwen2.5-coder-14b-instruct-q3_k_m.gguf PARAMETER temperature 0.7 PARAMETER top_p 0.9 PARAMETER num_ctx 8192步骤 7导入 Ollamaollama create qwen2.5-coder-14b -f D:\models\qwen2.5-coder-14b-gguf\Modelfile-coder14b成功标志输出success会自动将 GGUF 复制进.ollama\models\blobsD 盘再占约 7.3 GB步骤 8验证ollama list ollama run qwen2.5-coder-14b 用Python写一个快速排序只给代码 ollama ps验收标准ollama ps该模型的SIZE 约 7.3 GB。步骤 9接入 opencode编辑opencode.jsonc在 ollama provider 的 models 里添加{ name: qwen2.5-coder-14b, baseURL: http://localhost:11434/v1 }baseURL 必须带/v1apiKey 随意占位Ollama 不校验在trae中接入模型1. 打开添加模型对话框设置 → 模型 → 添加模型选择自定义模型2. 填写连接参数OpenAI 兼容三件套字段填写值说明API 地址 / Base URLhttp://localhost:11434/v1Ollama 的 OpenAI 兼容端点必须带 /v1API Keyollama任意字符串占位Ollama 不校验模型名称 / Model ID例如qwen2.5-coder-14b-int3必须是 ollama list 里的模型名不带 :latest 也行3. 保存并验证保存后模型会出现在模型列表里选择它即可对话 注意判断该接入的模型是否支持image若不支持在高级配置中选择不支持对话前确认 Ollama 服务在运行终端 ollama list 能出结果即正常注意事项Ollama 必须已启动Trae 是直连 localhost:11434Ollama 没开会报连接失败模型名严格一致填错会报 model not found用 ollama list 复制完整名字CORS 不用管Trae 走服务端/本机直连不需要像网页版那样开 OLLAMA_ORIGINS若 Trae 表单里要求填模型提供方选OpenAI兼容协议如果 Trae 的自定义模型表单字段名不同一般是 Name / Base URL / API Key 三个对应关系Name模型名、Base URLhttp://localhost:11434/v1、API Keyollama。填完直接保存即可。四、踩坑与注意事项1. 下载 SSL 报错处理报[SSL: UNEXPECTED_EOF_WHILE_READING]是网络瞬时断连按序处理直接重试同一条命令多数情况成功取消镜像直连官方Remove-Item Env:HF_ENDPOINT有代理软件时设置$env:HTTPS_PROXY http://127.0.0.1:7890端口按代理软件实际配置改临时关闭安全软件/换网络如手机热点排查2. 分片文件的 FROM 写法若下载的 GGUF 是分片如-00001-of-00002.ggufModelfile 的 FROM 只需写第一个分片llama.cpp/Ollama 自动找其余分片要求同目录、命名规范。3. gguf 源文件删除影响重建ollama create会把 GGUF 复制进 blobs删除源文件不影响已导入模型运行但 Modelfile 的 FROM 依赖源路径删掉后想改Modelfile中的其它配置会重建失败。验证稳定前建议保留源文件。5. huggingface-cli 已废弃新版直接使用hf命令旧命令会提示 deprecated。

相关推荐

Claude Code之父Boris谈工程师成长:从中级到Principal的五个关键转变
Claude Code之父Boris谈工程师成长:从中级到Principal的五个关键转变

最近我把 Boris Cherny 那场关于工程师成长的访谈翻来覆去看了好几遍,越想越觉得它被低估了。网上铺天盖地都是“Claude Code 怎么安装”“怎么接入 DeepSeek”“Windows 上怎么配”,真正值得反复琢磨的反而是 Boris 作为 Claude Code 的核心缔造者&… · 2026/9/26 4:16:35

EARR公式的结构与福耀玻璃的适用性
EARR公式的结构与福耀玻璃的适用性

EARR的完整公式为: EARRWRICRTERVA \text{EARR} \frac{W RI CR T ER}{VA} EARRVAWRICRTER​ 其中 VAVAVA 为企业增加值。福耀玻璃作为A股汽车玻璃行业的龙头企业,其年报披露了计算所需的全部关键数据:支付给职工的现金、研发投入、购建固… · 2026/9/26 4:16:35

AI编程工作流v2.0:从需求拆解到文档沉淀的完整实践指南
AI编程工作流v2.0:从需求拆解到文档沉淀的完整实践指南

我最早用AI编程的时候,其实是把它当搜索引擎用的——问一段代码,复制过来,跑不通再回去追问,反复横跳折腾大半年,效率没提上去,脾气倒是涨了不少。后来复盘才明白,问题根本不是模型不够聪明&… · 2026/9/26 4:16:28

2026 查重率和 AIGC 率都飘红?一站式AI智能降重工具实测盘点
2026 查重率和 AIGC 率都飘红?一站式AI智能降重工具实测盘点

一、前言:2026 高校论文审核新难题 随着高校学术审核体系不断升级,知网、维普等主流检测平台全面上线AIGC 智能检测功能,当代毕业生的论文写作与修改迎来双重考验。以往论文仅需攻克重复率超标问题,如今还要规避 AI 写作痕迹检测风… · 2026/9/26 5:03:35

自研文字排版引擎实战:从断行到字形的完整布局链路
自研文字排版引擎实战:从断行到字形的完整布局链路

1. 为什么"够用"的控件在复杂排版面前失灵——自研引擎的真实动机1.1 从一次真实需求说起我最早接触自定义文字排版引擎,是因为一个看似简单的需求:在一款设计师协作工具里,用户希望选中任意一段文字后,能像专业排版软件… · 2026/9/26 5:03:35

毕业论文神器!盘点2026年好评如潮的一键生成论文工具
毕业论文神器!盘点2026年好评如潮的一键生成论文工具

一天写完毕业论文在2026年已不再是天方夜谭。最新测评显示,2026年最炸裂的一键生成论文工具,实测提速超300%,覆盖选题、查重、润色、排版全流程,高效搞定毕业论文,学生必备神器。 一、全流程王者:一站式搞定… · 2026/9/26 5:03:35

自制浏览器扩展实战:Manifest V3标签页分组管理全攻略
自制浏览器扩展实战:Manifest V3标签页分组管理全攻略

简介:面向前端开发者的浏览器扩展实战资料,以Edge与Chrome标签页自定义插件为切入点,系统讲解基于HTML、CSS、jQuery及Chrome/Edge扩展API的完整开发流程。压缩包约14.64MB,涵盖扩展结构搭建、关键API调用、权限配置、打包发布与跨… · 2026/9/26 5:03:29

AI编程进阶:从能跑就行到敢进生产的工程化实践
AI编程进阶:从能跑就行到敢进生产的工程化实践

1. 从“能跑就行”到“敢让它进生产”:AI编程的第二道坎上一篇聊了AI编程入门阶段那些事——怎么让AI帮你写函数、补测试、解释报错。那会儿的核心诉求很简单:能跑就行。但真正把AI编程用出生产力,分水岭出现在你第一次决定“让AI写的代码进生… · 2026/9/26 5:03:29

永别密码登录:NodeWarden Passkey 无密码登录完整指南(WebAuthn/FIDO2 设置与跨设备同步)
永别密码登录:NodeWarden Passkey 无密码登录完整指南(WebAuthn/FIDO2 设置与跨设备同步)

永别密码登录:NodeWarden Passkey 无密码登录完整指南(WebAuthn/FIDO2 设置与跨设备同步) 【免费下载链接】nodewarden Bitwarden-compatible server running on Cloudflare Workers 项目地址: https://gitcode.com/gh_mirrors/no/nodeward… · 2026/9/26 5:03:29

数据库课后习题答案别硬背:当测试用例集刷,效率翻倍
数据库课后习题答案别硬背:当测试用例集刷,效率翻倍

简介:万常选版《数据库原理与设计》课后习题答案资源,覆盖第2至6章及第9章,适合正在学习关系模型、数据库建模、关系数据理论与模式求精的本科生、自学者作为复习与自测材料。压缩包共7个文件,含3个doc参考答案、2个sql示例脚本、… · 2026/9/26 0:00:21

OpenClaw 替代品?Hermes Agent 踩坑实录:macOS 飞书接入 TaoToken 配置
OpenClaw 替代品?Hermes Agent 踩坑实录:macOS 飞书接入 TaoToken 配置

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views … · 2026/9/26 0:00:40

向下兼容与向上兼容:接口设计中的兼容性策略与工程实践
向下兼容与向上兼容:接口设计中的兼容性策略与工程实践

一次版本升级事故,是很多团队绕不过去的坎。线上环境里,服务端明明已经上线了新版接口,老的移动端还在照着旧文档传参数。请求一到网关,校验直接拒绝,用户操作失败,客服群炸了锅,开发群里开始互… · 2026/9/26 0:00:46

了解更多?预约专属演示

我们的顾问将为您一对一讲解产品与方案

企业微信二维码