DeepSeekDSH
独立社区指南与 DeepSeek 无隶属关系。下载版本与教程参考

Qwen 3.8 27B 怎么接入 DSH?

Qwen 3.8 27B 接入 DSH 的配置参考:先验证本地服务,再检查模型 ID、协议和凭据,并分别验收文本、工具与图片输入。附官方文档、社区案例和版本说明。

维护:DeepSeekDSH(独立站点)资料整理
本页内容

Qwen 3.8 27B 接入 DSH,需要先启动提供 API 的本地推理服务。推理引擎加载模型文件,DSH 通过接口访问它。确认服务能独立回复后,再配置 DSH,分别检查文本、工具和图片输入;每一步的结果都能帮助定位故障。

本地推理服务与工作区任务分层验证的示意图

本文根据官方文档与已有教程整理,资料核对于 2026-10-02。DSH 配置参考提交 639ed015,源码版本为 0.2.0-rc.2;下述步骤不是本站硬件实测,安装版本不同的读者应先核对配置位置。

Qwen 本地模型与 DSH,分别负责什么?

Qwen 提供模型权重,推理引擎负责加载权重并响应请求,DSH 则管理会话和工具任务。模型文件下载后,还需要启动推理引擎,DSH 才能向这个服务发送请求。

Qwen 官方模型卡列出 vLLM、SGLang 等部署路径。个人电脑上使用 GGUF 时,要核对量化文件与推理引擎。选定引擎后,按它的说明准备文件和启动参数;本地服务与云端 DashScope 的认证配置也要分别核对。Qwen 官方模型卡

想直接使用云端 Qwen,可以看Qwen/DashScope 配置教程。这条路线由云端服务提供推理接口,无需先下载几十 GB 的权重。

部署前,先把环境记清楚

至少记下操作系统、GPU 和内存、量化文件、推理引擎 build,以及 DSH 版本。它们决定别人的命令能否适用于你的机器。

同样叫 27B,量化文件、视觉投影文件、上下文和并发设置都可能改变运行开销。不要只根据参数量判断显存,更不要把“模型支持长上下文”理解成“我的显卡可以直接开满”。

一个很具体的例子是 lybhb8 的 AMD 教程:作者在 2026-09-30 的修订中降低了上下文设置,并解释了显存不足带来的运行问题。同一篇文章也修正了早期“必须经过中间层”的判断。阅读这类教程时,修订记录比一张孤立的成功截图更有用。作者的环境与修订记录

新手先选一套与自己系统接近的环境,跑通较小任务。投机解码、超长窗口和多并发可以后置;把所有优化参数同时打开,反而很难定位第一处失败。

不开 DSH,先检查推理服务

以下以已经启动的 llama.cpp 服务为例,不是模型安装命令。端口按你的启动配置修改;Windows 终端可以使用 curl.exe。

curl http://127.0.0.1:8080/health
curl http://127.0.0.1:8080/v1/models

先检查服务是否就绪,再查看它返回的模型 ID。健康接口返回正常,不等于模型已经完成过一次文本生成。接着按对应引擎的官方接口说明发一个短请求,确认响应确实来自目标模型。如果服务启用了认证,模型列表和生成请求要带相应凭据,不要因此误判服务没有启动。llama.cpp 服务与接口说明

这里建议使用本机地址,不为验证连接临时开放公网。也不要把启动命令里的别名、权重仓库名和返回的模型 ID 混为一谈:DSH 请求的 ID 要与服务实际接受的值匹配。

把已验证的服务添加到 DSH

按所参考版本的官方模型指南,在模型设置中添加自定义模型 API。重点核对四件事:服务地址、协议、凭据和模型 ID。

配置项应该怎么填
地址本地服务对应的 API 根地址,例如已经验证的 /v1 地址,而不是服务的浏览器页面
协议与服务实际提供的接口一致;不能只因为地址带 /v1 就任选一种协议
凭据使用该服务需要的凭据;不要填云端平台的无关 Key
模型使用该服务实际接受的 ID,并按本机已验证的容量填写限制

可以使用模型发现功能,但发现成功之后仍需保存。若服务不能列出模型,先确认其是否提供相应接口,再决定是否手动添加,而不是反复更换一个已经验证的 Key。DSH 官方模型配置指南

配置文件的位置尤其要看版本。本文参考的是 Profile 下的 cordis.patch.yml;旧社区教程中的 settings.yaml 不能直接套进这一结构。优先通过界面保存,只有界面无法表达的设置才编辑配置,修改前保留原文件副本。

文本、工具、图片,分开验收

第一步只发送短文本,比如要求模型用一句话解释一个函数。确认当前会话选中了刚添加的模型,且服务日志收到了请求。

第二步在隔离工作区检查一个只读工具任务。可以让 DSH 列出目录文件,不允许创建、修改或删除文件。需要看到实际工具结果,而不是模型在回复里说“已经查看了目录”。先确认工作区权限与工具可用,再判断工具调用的解析是否出了问题。

第三步才测试图片。模型本身理解图片、服务支持视觉请求、DSH 声明图片输入,这是不同的条件。RAFOLIE 的旧版案例就是服务能识图,但 DSH 侧缺少输入声明;帖子同时给出了 Windows、RTX 4090 和 llama.cpp build,不能省掉这些条件只抄一行配置。社区案例与环境

测试用自己准备的一张非敏感图片。如果回复正常但描述明显不对,也不能只勾选“成功”:检查图片是否真的传入、服务是否加载所需投影文件,以及任务本身是否有明确答案。

常见问题

本地模型也需要 API Key 吗?

取决于服务和客户端。服务器可以不启用认证,但客户端仍可能要求提供凭据字段。先核对当前适配器说明;如果它要求占位凭据,应按文档设置,不要把真实云端 Key 发给无关本地服务。DSH 适配器的认证限制

可以直接复制别人的 128K 或更大上下文吗?

不建议。模型上限与机器、引擎和并发配置下能稳定运行的容量不是一回事。先以自己的服务配置和实际记录为准。

是不是一定要安装工具调用中间层?

不是普遍前提。先验证当前引擎的直接工具调用;只有出现可复现的问题,且明确中间层解决哪种请求差异时,才考虑增加它。

接下来做什么

Qwen 3.8 27B 接入 DSH 后,先完成一个可检查的只读任务,再尝试代码修改。保留服务配置与对应 DSH 版本,后续升级时才能比较变化。任务验证步骤可以接着看Web UI 指南和代码修复测试模板。

模型接入、选型与费用指南