回复太长:model_verbosity 写成 low,别去关推理
low / medium / high 只作用于 Responses API 的最终回复长度。Chat Completions 供应商会忽略。它不是 hide_agent_reasoning,也不是推理摘要。
模型目录里有的 GPT-5 系列默认就偏短或偏长。要压最终回复、又不想动推理强度:
model_verbosity = "low"
取值 low | medium | high。未设置时用当前模型/预设的默认。官方进阶配置写明:只对走 Responses API 的供应商生效;Chat Completions(不少第三方网关的 wire_api = "chat")会直接忽略,看起来像「配了没反应」。
三件容易混的事:
model_reasoning_effort:模型想多久model_reasoning_summary:思维链摘要写多细(none可关掉摘要)hide_agent_reasoning:藏 reasoning 事件,不改变计算
model_verbosity 管的是最终助手消息有多啰嗦。CI 日志太吵先 hide 事件;回复本身注水再调 verbosity。改完新开会话,用 /debug-config 看实际加载值。