DeepSeek V4.1 Flash 接入 Harness:模型 ID 与配置指南

作者
DeepSeekAgent.io 编辑部
发布
更新

DeepSeek V4.1 Flash 在官方 API 中使用 deepseek-flash 作为模型 ID。当前 @deepseek-ai/dsh-llm-deepseek 源码也已经把它加入默认模型目录,声明文本与图片输入、100 万 Token 上下文,并提供 offlowhighmax 四档推理强度。

本文集中解决模型与 Harness 之间的配置问题:该选哪个 ID、DSH 会发送什么、图片能力如何声明,以及旧版 V4 Flash Session 迁移时应该验证哪些环节。

使用当前模型 ID

新的官方 API 配置应选择:

deepseek-flash

DeepSeek 表示,已经退役的 deepseek-v4-flashdeepseek-v4-flash-vision-exp 暂时会路由到 V4.1 Flash。这两个别名可以减少现有应用立即报错的概率,定位是兼容路径。新 Profile 直接使用 deepseek-flash,后续迁移更清楚。

当前 DSH 模型目录可能把显示名称写成缺少小数点的 DeepSeek-V41-Flash。它对应的底层 ID 仍然是 deepseek-flash。社区讨论在 @deepseek-ai/[email protected] 中定位了这个显示问题,仓库源码也能核对 ID 与名称。不要为了匹配显示名称而修改请求 ID。

优先使用内置官方路由

DSH 使用 DeepSeek 官方 Provider 与默认模型目录时,当前源码会自动提供 V4.1 条目。API Key 建议放在环境变量中,避免把密钥写入 Composition:

export DEEPSEEK_API_KEY="your-key"

随后在 DSH 的模型选择器或 Profile 中选择 deepseek-flash。如果已安装版本早于 V4.1 目录更新,可以按自己明确使用的包渠道升级,或先备份配置,再显式加入模型条目。

自定义兼容 Endpoint 示例

兼容网关提供 V4.1 Flash 时,可以参考下面的结构。baseURL 与各项限制应以实际 Provider 文档为准:

- name: '@deepseek-ai/dsh-llm-deepseek'
  config:
    apiKeyEnv: DEEPSEEK_API_KEY
    baseURL: https://your-compatible-endpoint.example/v1
    reasoningEffort: high
    maxTokens: 256000
    defaultContextWindow: 1000000
    models:
      - id: deepseek-flash
        name: DeepSeek-V4.1-Flash
        inputModalities:
          - text
          - image
        contextWindow: 1000000
        maxTokens: 256000

显式填写 models 数组会整体替换默认目录,仍需使用的其他模型也要复制进去。兼容服务有时会采用自己的部署名称,所以还要核对该 Endpoint 是否接受官方模型 ID。

推理强度与输出上限

模型 API 支持 1–100 的连续推理强度。当前 DSH 插件对用户暴露 offlowhighmax,插件默认值为 high。DeepSeek 发布的 Instruct Benchmark 使用最高推理强度,所以表格成绩不能直接当成 highlow 档位的预期表现。

日常编码可以从 high 开始。复杂调试、代码库级规划或 Benchmark 复现再使用 max,同时记录质量与成本。官方模型卡为评测型配置建议至少提供 256K 输出空间;生产任务边界明确时,可以设置更小上限控制失控输出。

图片输入检查

V4.1 Flash 是原生多模态模型。当前 DSH 默认目录为 deepseek-flash 声明了 textimage。自定义目录也要保留这项声明,否则 Session Controller 可能在请求到达模型前拒绝附件。

图片失败时,按下面顺序检查:

  1. 确认当前选择的条目是 deepseek-flash
  2. 检查 inputModalities 是否包含 textimage
  3. 先发送一张小尺寸 JPEG 或 PNG,再测试大量截图。
  4. 核对兼容 Endpoint 是否支持 V4.1 图片输入与相同传输格式。
  5. 区分 DSH 本地能力报错和上游 API 报错。

完整附件链路可以参考 DSH 视觉模型排错指南

从 V4 Flash 迁移的检查清单

  • 新配置改用 deepseek-flash
  • 只有在明确依赖临时别名时才保留旧 ID。
  • 重要历史 Trajectory 继续运行前,先新建 Session 做冒烟测试。
  • 分别测试一个文本任务、一个图片任务和一个真实工具任务。
  • 记录 DSH 版本、Profile、推理强度、Endpoint、模型 ID、耗时、Token 口径与结果。
  • 检查自定义模型列表,因为它会替换默认目录。

长上下文代表容量,不保证所有 Session 都适合增长到 100 万 Token。社区中有一例超长上下文、最高推理强度下出现循环思考的报告。它可以作为排错信号,仍不足以证明 V4.1 存在普遍缺陷。如果 Session 长时间没有产生有效工具或文本事件,可以保存 Trajectory,从干净检查点重试,降低推理强度,并与较短上下文对照。

相关阅读

常见问题

DSH 调用 V4.1 Flash 应该发送哪个模型 ID?

使用 deepseek-flash。当前一个 DSH 显示名称缺少小数点,不会改变 API 模型 ID。

还能继续使用 deepseek-v4-flash 吗?

DeepSeek 当前会把这个已退役 ID 兼容路由到 V4.1 Flash。由于兼容期是临时安排,新配置应使用 deepseek-flash

推理强度应该选哪一档?

日常编码与 Agent 工作可以从 high 开始。任务确实需要更多推理预算时再用 max,并通过实际结果判断它是否值得。