fix(honcho): override deduction/induction specialist model to deepseek/siliconflow

honcho-deriver dreamer 模块的 deduction/induction specialist 有独立的
model config(src/config.py:1189-1208),默认值 hardcode gpt-5.4-mini +
openai SDK 默认 endpoint(api.openai.com/v1)。原 stack.yml 只覆盖了
DERIVER_MODEL_CONFIG 和 EMBEDDING_MODEL_CONFIG,导致 dream cycle 在
国内持续 timeout。

- stack.yml deriver 段显式注入 DEDUCTION_MODEL_CONFIG__* /
  INDUCTION_MODEL_CONFIG__*(model=deepseek-ai/DeepSeek-V4-Flash,
  base_url=https://api.siliconflow.cn/v1)
- DERIVER_MODEL_CONFIG__OVERRIDES__BASE_URL 同步加上
- env.cfg.example: 同步 HONCHO_DEDUCTION_MODEL /
  HONCHO_INDUCTION_MODEL 变量;HONCHO_DERIVER_MODEL 默认值从 gpt-5.4-mini
  改为 deepseek-ai/DeepSeek-V4-Flash;HONCHO_LLM_BASE_URL 默认从 openai.com
  改为 siliconflow.cn

诊断依据:vm61 docker inspect honcho-deriver + logs 显示
src.dreamer.orchestrator 仍在请求 openai/gpt-5.4-mini。
.env.*
This commit is contained in:
2026-06-19 21:21:46 +08:00
parent 7309ec1261
commit 8b07e76d67
2 changed files with 15 additions and 3 deletions
+7 -2
View File
@@ -61,14 +61,19 @@ HONCHO_EMBEDDING_BASE_URL=https://api.siliconflow.cn/v1
# 必须与已有 DB schema 的 public.documents.embedding dim 一致;切换模型必须先 migrate 旧数据 # 必须与已有 DB schema 的 public.documents.embedding dim 一致;切换模型必须先 migrate 旧数据
# 若 Honcho 自动推断失败,需在 stack.yml 同步设置 EMBEDDING_VECTOR_DIMENSIONS=1536 # 若 Honcho 自动推断失败,需在 stack.yml 同步设置 EMBEDDING_VECTOR_DIMENSIONS=1536
# deriver 必须用支持 tool calling 的模型 # deriver 必须用支持 tool calling 的模型
HONCHO_DERIVER_MODEL=gpt-5.4-mini HONCHO_DERIVER_MODEL=deepseek-ai/DeepSeek-V4-Flash
# dreamer 的 deduction/induction specialist(默认走 OpenAI SDK + gpt-5.4-mini
# 会请求 api.openai.com/v1 在国内超时);必须显式覆盖到国内可达端点
HONCHO_DEDUCTION_MODEL=deepseek-ai/DeepSeek-V4-Flash
HONCHO_INDUCTION_MODEL=deepseek-ai/DeepSeek-V4-Flash
HONCHO_DERIVER_WORKERS=1 HONCHO_DERIVER_WORKERS=1
# ============================================================ # ============================================================
# LLMOpenAI 兼容协议;可换 OpenRouter / vLLM / Ollama 等端点) # LLMOpenAI 兼容协议;可换 OpenRouter / vLLM / Ollama 等端点)
# deriver 启动时强校验 API Key 非空,占位符会反复重启 # deriver 启动时强校验 API Key 非空,占位符会反复重启
# 注意:必须同时被 deriver/dreamer/embedding 复用,否则 specialist 会回落 openai.com
# ============================================================ # ============================================================
HONCHO_LLM_BASE_URL=https://api.openai.com/v1 HONCHO_LLM_BASE_URL=https://api.siliconflow.cn/v1
# ============================================================ # ============================================================
# 敏感值(必填,env.cfg 不提交)— 在 .gitignore 已忽略 # 敏感值(必填,env.cfg 不提交)— 在 .gitignore 已忽略
+8 -1
View File
@@ -93,7 +93,14 @@ services:
- CACHE_ENABLED=true - CACHE_ENABLED=true
- NAMESPACE=${HONCHO_NAMESPACE:-honcho} - NAMESPACE=${HONCHO_NAMESPACE:-honcho}
- DERIVER_MODEL_CONFIG__TRANSPORT=openai - DERIVER_MODEL_CONFIG__TRANSPORT=openai
- DERIVER_MODEL_CONFIG__MODEL=${HONCHO_DERIVER_MODEL:-gpt-5.4-mini} - DERIVER_MODEL_CONFIG__MODEL=${HONCHO_DERIVER_MODEL:-deepseek-ai/DeepSeek-V4-Flash}
- DERIVER_MODEL_CONFIG__OVERRIDES__BASE_URL=${HONCHO_LLM_BASE_URL:-https://api.siliconflow.cn/v1}
- DEDUCTION_MODEL_CONFIG__TRANSPORT=openai
- DEDUCTION_MODEL_CONFIG__MODEL=${HONCHO_DEDUCTION_MODEL:-deepseek-ai/DeepSeek-V4-Flash}
- DEDUCTION_MODEL_CONFIG__OVERRIDES__BASE_URL=${HONCHO_LLM_BASE_URL:-https://api.siliconflow.cn/v1}
- INDUCTION_MODEL_CONFIG__TRANSPORT=openai
- INDUCTION_MODEL_CONFIG__MODEL=${HONCHO_INDUCTION_MODEL:-deepseek-ai/DeepSeek-V4-Flash}
- INDUCTION_MODEL_CONFIG__OVERRIDES__BASE_URL=${HONCHO_LLM_BASE_URL:-https://api.siliconflow.cn/v1}
- DERIVER_WORKERS=${HONCHO_DERIVER_WORKERS:-1} - DERIVER_WORKERS=${HONCHO_DERIVER_WORKERS:-1}
- EMBEDDING_MODEL_CONFIG__TRANSPORT=openai - EMBEDDING_MODEL_CONFIG__TRANSPORT=openai
- EMBEDDING_MODEL_CONFIG__MODEL=${HONCHO_EMBEDDING_MODEL:-Qwen/Qwen3-Embedding-8B} - EMBEDDING_MODEL_CONFIG__MODEL=${HONCHO_EMBEDDING_MODEL:-Qwen/Qwen3-Embedding-8B}