指南
基于一方来源的配置与运维指南,覆盖 provider 配置、V4 Pro 与 Flash 选择、思考控制、工具调用历史、成本时段和安全边界。
发布于 · 更新于
当你需要具备记忆、Skills、多渠道和定时任务的长期多供应商 Agent 时,可选择 Hermes 接入 DeepSeek;当你明确需要 DeepSeek 自有插件运行时和轨迹模型时,选择 DeepSeek Harness。无论哪种方案,都要分别控制模型成本、仓库访问和工具执行。
本指南依据 Hermes 官方仓库、provider 插件和发布版本,以及 DeepSeek V4 价格与思考模式文档。不推断账号特定支付可用性,也不保证未来配置提示完全不变。
应按负载形态选择。V4 Pro 更适合困难编程、调试和长程 Agent 任务;V4 Flash 更适合迭代、常规自动化和大批量任务队列。应分别记录稳定公开模型 ID 与当前实际路由的托管快照。
在终端运行 `hermes model`,选择 DeepSeek,并通过受支持的凭据提示完成配置。修改 provider 配置后启动新会话。在聊天中,`/model` 只能在已配置 provider 之间切换,不能新增 provider 或收集新 Key。
使用终端配置向导添加 DeepSeek 账号与模型。
配置完成后再使用 `/model`,切换后确认状态。
DeepSeek V4 支持思考控制,多步工具调用可能要求此前的 reasoning content 保留在对话历史中。Hermes 原生插件会处理 V4 协议形态、转发 thinking 与 reasoning-effort 控制,并保留所需推理历史。不要添加会盲目删除推理字段的中间件。
Hermes 原生插件默认开启 DeepSeek V4 思考模式,并支持显式覆盖。
将 provider 要求的 reasoning content 与对应 assistant 工具调用轮次一起保留。
DeepSeek 公布 UTC 峰段与谷段,而 Hermes 可运行无人值守的定时任务和消息工作流。应先设置任务预算、输出限制和并发。隔离生产仓库,对破坏性或外部操作要求审批,完成消息用户配对,并审查每个 MCP Server、Skill 和远程工具。
将灵活负载安排到谷段,并限制自主任务范围、Token 和并发。
使用审批、沙箱、网关认证、已审查 Skills 和最小权限 provider Key。