DeepSeek V4.1 Flash in DeepSeek Harness
DeepSeek V4.1 Flash 接入 Harness:模型 ID 与配置指南
- 作者
- DeepSeekAgent.io 编辑部
- 发布
- 更新
DeepSeek V4.1 Flash 在官方 API 中使用 deepseek-flash 作为模型 ID。当前 @deepseek-ai/dsh-llm-deepseek 源码也已经把它加入默认模型目录,声明文本与图片输入、100 万 Token 上下文,并提供 off、low、high、max 四档推理强度。
本文集中解决模型与 Harness 之间的配置问题:该选哪个 ID、DSH 会发送什么、图片能力如何声明,以及旧版 V4 Flash Session 迁移时应该验证哪些环节。
使用当前模型 ID
新的官方 API 配置应选择:
deepseek-flash
DeepSeek 表示,已经退役的 deepseek-v4-flash 与 deepseek-v4-flash-vision-exp 暂时会路由到 V4.1 Flash。这两个别名可以减少现有应用立即报错的概率,定位是兼容路径。新 Profile 直接使用 deepseek-flash,后续迁移更清楚。
当前 DSH 模型目录可能把显示名称写成缺少小数点的 DeepSeek-V41-Flash。它对应的底层 ID 仍然是 deepseek-flash。社区讨论在 @deepseek-ai/[email protected] 中定位了这个显示问题,仓库源码也能核对 ID 与名称。不要为了匹配显示名称而修改请求 ID。
优先使用内置官方路由
DSH 使用 DeepSeek 官方 Provider 与默认模型目录时,当前源码会自动提供 V4.1 条目。API Key 建议放在环境变量中,避免把密钥写入 Composition:
export DEEPSEEK_API_KEY="your-key"
随后在 DSH 的模型选择器或 Profile 中选择 deepseek-flash。如果已安装版本早于 V4.1 目录更新,可以按自己明确使用的包渠道升级,或先备份配置,再显式加入模型条目。
自定义兼容 Endpoint 示例
兼容网关提供 V4.1 Flash 时,可以参考下面的结构。baseURL 与各项限制应以实际 Provider 文档为准:
- name: '@deepseek-ai/dsh-llm-deepseek'
config:
apiKeyEnv: DEEPSEEK_API_KEY
baseURL: https://your-compatible-endpoint.example/v1
reasoningEffort: high
maxTokens: 256000
defaultContextWindow: 1000000
models:
- id: deepseek-flash
name: DeepSeek-V4.1-Flash
inputModalities:
- text
- image
contextWindow: 1000000
maxTokens: 256000
显式填写 models 数组会整体替换默认目录,仍需使用的其他模型也要复制进去。兼容服务有时会采用自己的部署名称,所以还要核对该 Endpoint 是否接受官方模型 ID。
推理强度与输出上限
模型 API 支持 1–100 的连续推理强度。当前 DSH 插件对用户暴露 off、low、high 与 max,插件默认值为 high。DeepSeek 发布的 Instruct Benchmark 使用最高推理强度,所以表格成绩不能直接当成 high 或 low 档位的预期表现。
日常编码可以从 high 开始。复杂调试、代码库级规划或 Benchmark 复现再使用 max,同时记录质量与成本。官方模型卡为评测型配置建议至少提供 256K 输出空间;生产任务边界明确时,可以设置更小上限控制失控输出。
图片输入检查
V4.1 Flash 是原生多模态模型。当前 DSH 默认目录为 deepseek-flash 声明了 text 与 image。自定义目录也要保留这项声明,否则 Session Controller 可能在请求到达模型前拒绝附件。
图片失败时,按下面顺序检查:
- 确认当前选择的条目是
deepseek-flash。 - 检查
inputModalities是否包含text与image。 - 先发送一张小尺寸 JPEG 或 PNG,再测试大量截图。
- 核对兼容 Endpoint 是否支持 V4.1 图片输入与相同传输格式。
- 区分 DSH 本地能力报错和上游 API 报错。
完整附件链路可以参考 DSH 视觉模型排错指南。
从 V4 Flash 迁移的检查清单
- 新配置改用
deepseek-flash。 - 只有在明确依赖临时别名时才保留旧 ID。
- 重要历史 Trajectory 继续运行前,先新建 Session 做冒烟测试。
- 分别测试一个文本任务、一个图片任务和一个真实工具任务。
- 记录 DSH 版本、Profile、推理强度、Endpoint、模型 ID、耗时、Token 口径与结果。
- 检查自定义模型列表,因为它会替换默认目录。
长上下文代表容量,不保证所有 Session 都适合增长到 100 万 Token。社区中有一例超长上下文、最高推理强度下出现循环思考的报告。它可以作为排错信号,仍不足以证明 V4.1 存在普遍缺陷。如果 Session 长时间没有产生有效工具或文本事件,可以保存 Trajectory,从干净检查点重试,降低推理强度,并与较短上下文对照。
相关阅读
- DeepSeek V4.1 Flash 完整解读
- 使用 DSH Minimal 复现 DeepSWE
- V4.1 Flash 与 V4 Flash 的 Harness 场景对比
- DeepSeek Harness 完整教程
常见问题
DSH 调用 V4.1 Flash 应该发送哪个模型 ID?
使用 deepseek-flash。当前一个 DSH 显示名称缺少小数点,不会改变 API 模型 ID。
还能继续使用 deepseek-v4-flash 吗?
DeepSeek 当前会把这个已退役 ID 兼容路由到 V4.1 Flash。由于兼容期是临时安排,新配置应使用 deepseek-flash。
推理强度应该选哪一档?
日常编码与 Agent 工作可以从 high 开始。任务确实需要更多推理预算时再用 max,并通过实际结果判断它是否值得。