SERVER_HOST=0.0.0.0 SERVER_PORT=8080 PORT=8080 FREE_ACCOUNTS=true FREE_ACCOUNTS_NUM=1024 Authorization= TLS_CERT= TLS_KEY= PROXY_URL= http_proxy= # 转发代理(可选,给 backend-api / files 端点单独配置) API_REVERSE_PROXY= FILES_REVERSE_PROXY= # 自定义 BASE_URL(默认 https://chatgpt.com/backend-api) BASE_URL= # 流式响应开关;设为 "false" 强制返回完整响应 STREAM_MODE=true # 是否在请求中保留历史上下文;设为 "true" 启用 ENABLE_HISTORY=false # MAX_CONTINUE_COUNT: 模型因 max_tokens 停止时,自动 continue 的最大轮数。 # 默认 3;设为 0 可关闭自动 continue(遇到长度限制立即停止,不再续写)。 MAX_CONTINUE_COUNT=3 # DEBUG_SSE: 设为 "true" 时,在控制台打印每个 SSE chunk 的解析日志, # 用于排查流式响应丢包/截断问题。生产建议留空。 # DEBUG_SSE=true # ---------- 工具调用模拟(Tool Calling Emulation)---------- # ChatGPT Web 不原生支持 function calling。aurora 复刻 的 # {...} 文本协议:在 system prompt 中教模型按格式输出, # 流式响应中实时切分出 tool_calls。 # # TOOL_CALLING_ENABLED: 是否启用。默认 true(只要请求体里声明了 tools)。 # 设为 false / 0 / no 强制关闭(忽略 tools 字段)。 # 启用时强制 stream=false(sandbox 重试需要完整响应),返回非流式 ChatCompletion。 TOOL_CALLING_ENABLED=true # REFUSAL_RETRIES: 模型陷入"sandbox 拒绝"循环时的最大重试次数。 # 每次重试会在末尾追加 _retrySuffix 提示模型立即输出 块。 # 仅在工具调用模式生效;默认 3。 REFUSAL_RETRIES=3 # DEBUG_TOOL_LOG: 设为文件路径后,把每次工具解析的详细 trace 写入该文件 # (输入 text、解析结果、tool_calls 等)。调试用,生产建议留空。 # DEBUG_TOOL_LOG=tool_debug.log