• 简体中文
  • 模型配置参考

    本页汇总 Midscene 的全部模型配置。如需查看支持的模型名称、模型 family 和可复制的配置示例,请参考支持的模型与配置。如需了解模型职责和组合方式,请参考模型策略。如需排查连接问题、查看日志、采集 Trace 或记录调用,请参考模型调试与可观测性

    必选配置

    你需要为 Midscene 配上一个默认模型,详见 模型策略 文档。

    名称描述
    MIDSCENE_MODEL_API_KEYOpenAI 兼容 HTTP 服务需要的模型 API Key,如 "sk-abcd..."。当 MIDSCENE_MODEL_BASE_URL="codex://app-server" 时不需要,具体设置请参考使用 Codex App Server
    MIDSCENE_MODEL_BASE_URLAPI 的接入 URL,常见以版本号结尾(如/v1);不需要编写最后的 /chat/completion 部分,底层 SDK 会自动添加
    MIDSCENE_MODEL_NAME模型名称
    MIDSCENE_MODEL_FAMILY模型系列,用于确定坐标处理方式

    高阶配置(可选)

    如果你为 Insight 或 Planning 配置了独立模型,那么本节中的模型相关 MIDSCENE_MODEL_* 配置需要使用对应的 MIDSCENE_INSIGHT_MODEL_*MIDSCENE_PLANNING_MODEL_* 配置才能在 Insight 或 Planning 意图时生效。

    名称描述
    MIDSCENE_MODEL_TIMEOUTAI 接口调用硬超时(毫秒,默认意图),默认 180000(180 秒)。设为 0 可禁用硬超时,只有调用方传入的 AbortSignal 能取消请求。说明:Midscene 控制的是完整请求生命周期,而不只是首个响应 header 返回的时间,因此即使响应体读取阶段卡住,也能被及时终止
    MIDSCENE_MODEL_TEMPERATURE模型采样温度
    MIDSCENE_MODEL_RETRY_COUNTAI 调用失败时的重试次数,默认 1(即失败后重试 1 次)。模型请求遇到 HTTP 错误,或模型返回值无法被结构化解析时,都会发起重试
    MIDSCENE_MODEL_RETRY_INTERVALAI 调用重试间隔毫秒数,默认 2000
    MIDSCENE_MODEL_REASONING_ENABLED控制是否启用模型的原生思考能力,Midscene 默认关闭。详见模型原生思考
    MIDSCENE_MODEL_REASONING_EFFORT控制模型的原生思考力度,部分模型支持。常用值:lowmediumhigh。详见模型原生思考
    MIDSCENE_MODEL_REASONING_BUDGET思考 Token 预算(数字),部分模型支持。详见模型原生思考
    MIDSCENE_MODEL_RESPONSE_FORMAT结构化响应策略:auto(默认)表示 Midscene 会在合适的场景自动使用 response_format 参数指定模型输出的结构化格式(一般是 JSON),来尽可能保证模型返回值能够被结构化解析;none 表示不指定 response_format 参数,适用于模型不支持结构化输出的情况。
    MIDSCENE_MODEL_HTTP_PROXYHTTP/HTTPS 代理配置,如 http://127.0.0.1:8080https://proxy.example.com:8080,优先级高于 MIDSCENE_MODEL_SOCKS_PROXY
    MIDSCENE_MODEL_SOCKS_PROXYSOCKS 代理配置,如 socks5://127.0.0.1:1080
    MIDSCENE_MODEL_INIT_CONFIG_JSON覆盖 OpenAI SDK 初始化配置的 JSON。自定义鉴权 header 请使用 defaultHeadersextra_headersextraHeaders 也会作为别名兼容
    MIDSCENE_MODEL_EXTRA_BODY_JSON合并到每次 chat completion 请求体中的 JSON。与 MIDSCENE_MODEL_INIT_CONFIG_JSON(配置 SDK 客户端)不同,此参数会展开到每次发送到模型的 completion.create() 调用体中,例如在 vLLM 中启用思考模式:'{"chat_template_kwargs":{"enable_thinking":true}}'

    提示:通过 Agent 的 replanningCycleLimit 入参控制重规划次数(默认 20,vlm-ui-tars 为 40),不再使用环境变量。

    为 Insight 意图单独配置模型

    如果你想为 Insight 意图单独配置模型,需额外配置以下字段:

    名称描述
    MIDSCENE_INSIGHT_MODEL_API_KEYAPI Key
    MIDSCENE_INSIGHT_MODEL_BASE_URLAPI 的接入 URL,常见以版本号结尾(如/v1);不需要编写最后的 /chat/completion 部分
    MIDSCENE_INSIGHT_MODEL_NAME模型名称
    MIDSCENE_INSIGHT_MODEL_FAMILY模型 family
    MIDSCENE_INSIGHT_MODEL_TIMEOUT可选,Insight 意图的 AI 接口调用超时时间(毫秒)
    MIDSCENE_INSIGHT_MODEL_TEMPERATURE可选,Insight 意图的模型采样温度
    MIDSCENE_INSIGHT_MODEL_RETRY_COUNT可选,效果等同于 MIDSCENE_MODEL_RETRY_COUNT
    MIDSCENE_INSIGHT_MODEL_RETRY_INTERVAL可选,效果等同于 MIDSCENE_MODEL_RETRY_INTERVAL
    MIDSCENE_INSIGHT_MODEL_HTTP_PROXY可选,效果等同于 MIDSCENE_MODEL_HTTP_PROXY
    MIDSCENE_INSIGHT_MODEL_SOCKS_PROXY可选,效果等同于 MIDSCENE_MODEL_SOCKS_PROXY
    MIDSCENE_INSIGHT_MODEL_INIT_CONFIG_JSON可选,效果等同于 MIDSCENE_MODEL_INIT_CONFIG_JSON
    MIDSCENE_INSIGHT_MODEL_EXTRA_BODY_JSON可选,效果等同于 MIDSCENE_MODEL_EXTRA_BODY_JSON
    MIDSCENE_INSIGHT_MODEL_RESPONSE_FORMAT可选,在合适的 Insight 场景中控制结构化响应策略

    为 Planning 意图单独配置模型

    如果你想为 Planning 意图单独配置模型,需额外配置以下字段:

    名称描述
    MIDSCENE_PLANNING_MODEL_API_KEYAPI Key
    MIDSCENE_PLANNING_MODEL_BASE_URLAPI 的接入 URL,常见以版本号结尾(如/v1);不需要编写最后的 /chat/completion 部分
    MIDSCENE_PLANNING_MODEL_NAME模型名称
    MIDSCENE_PLANNING_MODEL_FAMILY模型 family
    MIDSCENE_PLANNING_MODEL_TIMEOUT可选,Planning 意图的 AI 接口调用超时时间(毫秒)
    MIDSCENE_PLANNING_MODEL_TEMPERATURE可选,Planning 意图的模型采样温度
    MIDSCENE_PLANNING_MODEL_RETRY_COUNT可选,效果等同于 MIDSCENE_MODEL_RETRY_COUNT
    MIDSCENE_PLANNING_MODEL_RETRY_INTERVAL可选,效果等同于 MIDSCENE_MODEL_RETRY_INTERVAL
    MIDSCENE_PLANNING_MODEL_HTTP_PROXY可选,效果等同于 MIDSCENE_MODEL_HTTP_PROXY
    MIDSCENE_PLANNING_MODEL_SOCKS_PROXY可选,效果等同于 MIDSCENE_MODEL_SOCKS_PROXY
    MIDSCENE_PLANNING_MODEL_INIT_CONFIG_JSON可选,效果等同于 MIDSCENE_MODEL_INIT_CONFIG_JSON
    MIDSCENE_PLANNING_MODEL_EXTRA_BODY_JSON可选,效果等同于 MIDSCENE_MODEL_EXTRA_BODY_JSON
    MIDSCENE_PLANNING_MODEL_RESPONSE_FORMAT可选,在合适的 Planning 场景中控制结构化响应策略

    模型原生思考

    Midscene 默认关闭模型原生思考,以获得更好的执行速度和稳定性。如果模型不支持关闭原生思考,Midscene 会通过控制思考粒度或限制思考额度,尽可能减少模型的原生思考。

    以下环境变量是 Midscene 对不同模型服务商参数的统一抽象。实际发送给模型的参数由 MIDSCENE_MODEL_FAMILY 决定。

    MIDSCENE_MODEL_REASONING_ENABLED 显式控制是否启用模型原生思考:

    • false:强制关闭模型原生思考,也是 Midscene 的默认行为。
    • true:强制启用模型原生思考。
    • default:遵循模型的默认行为。Midscene 不发送启用或关闭思考的参数,并忽略显式配置的 MIDSCENE_MODEL_REASONING_BUDGETMIDSCENE_MODEL_REASONING_EFFORT

    目前支持 MIDSCENE_MODEL_REASONING_ENABLED 的模型系列及参数映射如下:

    • Qwen:对应 enable_thinking
    • 豆包:对应 thinking.type
    • 智谱 GLM:对应 thinking.type
    • GPT-5:对应 reasoning_effort。启用时使用 medium,关闭时使用 none
    • Gemini:对应 thinking_config.thinking_level。启用时使用 medium,关闭时使用 minimal
    • Kimi K2 系列:对应 thinking.type
    • 小米 MiMo:对应 thinking.type

    MIDSCENE_MODEL_REASONING_BUDGET 控制模型的思考额度。目前 Qwen 系列支持该配置,对应 thinking_budget

    MIDSCENE_MODEL_REASONING_EFFORT 控制模型的思考力度。目前支持以下模型系列:

    • 豆包:对应 reasoning_effort
    • Gemini:对应 thinking_config.thinking_level
    • GPT-5:对应 reasoning_effort
    • Kimi K3 系列:对应 reasoning_effort

    不同模型服务商支持的参数和值不同。具体取值和适用模型版本请参考对应服务商的官方文档。如果当前模型不支持某项显式配置,Midscene 会忽略该配置,不会猜测服务商的私有参数。

    仍兼容的模型配置(不推荐)

    以下环境变量已废弃但仍然兼容,建议尽快迁移到新的配置方式。

    旧版模型类型配置

    名称描述新配置方式
    MIDSCENE_USE_DOUBAO_VISION已弃用。启用豆包视觉模型使用 MIDSCENE_MODEL_FAMILY="doubao-vision"
    MIDSCENE_USE_QWEN3_VL已弃用。启用千问 Qwen3-VL 模型使用 MIDSCENE_MODEL_FAMILY="qwen3-vl"
    MIDSCENE_USE_QWEN_VL已弃用。启用千问 Qwen2.5-VL 模型使用 MIDSCENE_MODEL_FAMILY="qwen2.5-vl"
    MIDSCENE_USE_GEMINI已弃用。启用 Gemini 模型使用 MIDSCENE_MODEL_FAMILY="gemini"
    MIDSCENE_USE_VLM_UI_TARS已弃用。启用 UI-TARS 模型使用 MIDSCENE_MODEL_FAMILY="vlm-ui-tars"

    通用配置

    名称描述新配置方式
    OPENAI_API_KEY已弃用但仍兼容使用 MIDSCENE_MODEL_API_KEY
    OPENAI_BASE_URL已弃用但仍兼容使用 MIDSCENE_MODEL_BASE_URL
    MIDSCENE_OPENAI_INIT_CONFIG_JSON已弃用但仍兼容使用 MIDSCENE_MODEL_INIT_CONFIG_JSON
    MIDSCENE_OPENAI_HTTP_PROXY已弃用但仍兼容使用 MIDSCENE_MODEL_HTTP_PROXY
    MIDSCENE_OPENAI_SOCKS_PROXY已弃用但仍兼容使用 MIDSCENE_MODEL_SOCKS_PROXY

    调试与可观测性配置

    以下配置用于启用模型诊断、Tracing 和本地调用记录。安装步骤、使用示例、问题排查和安全说明。请参考模型调试与可观测性

    Debug 日志

    支持的 DEBUG 选择器和日志行为请参考运行时配置:Debug 日志

    LangSmith

    名称描述
    MIDSCENE_LANGSMITH_DEBUG设置为 1,启用 Midscene 的 LangSmith 自动集成
    LANGCHAIN_API_KEYLangSmith API Key
    LANGCHAIN_TRACING设置为 true,启用 LangSmith Tracing
    LANGCHAIN_ENDPOINTLangSmith 服务地址

    Langfuse

    名称描述
    MIDSCENE_LANGFUSE_DEBUG设置为 1,启用 Midscene 的 Langfuse 自动集成
    LANGFUSE_PUBLIC_KEYLangfuse Public Key
    LANGFUSE_SECRET_KEYLangfuse Secret Key
    LANGFUSE_BASE_URLLangfuse 服务地址

    模型调用记录

    名称描述
    MIDSCENE_RECORD_MODEL_CALL设置为 true,将模型请求、响应和流式 Chunk 写入本地 JSONL 文件