| SERVER_HOST=0.0.0.0 | |
| SERVER_PORT=8080 | |
| PORT=8080 | |
| FREE_ACCOUNTS=true | |
| FREE_ACCOUNTS_NUM=1024 | |
| Authorization= | |
| TLS_CERT= | |
| TLS_KEY= | |
| PROXY_URL= | |
| http_proxy= | |
| # 转发代理(可选,给 backend-api / files 端点单独配置) | |
| API_REVERSE_PROXY= | |
| FILES_REVERSE_PROXY= | |
| # 自定义 BASE_URL(默认 https://chatgpt.com/backend-api) | |
| BASE_URL= | |
| # 流式响应开关;设为 "false" 强制返回完整响应 | |
| STREAM_MODE=true | |
| # 是否在请求中保留历史上下文;设为 "true" 启用 | |
| ENABLE_HISTORY=false | |
| # MAX_CONTINUE_COUNT: 模型因 max_tokens 停止时,自动 continue 的最大轮数。 | |
| # 默认 3;设为 0 可关闭自动 continue(遇到长度限制立即停止,不再续写)。 | |
| MAX_CONTINUE_COUNT=3 | |
| # DEBUG_SSE: 设为 "true" 时,在控制台打印每个 SSE chunk 的解析日志, | |
| # 用于排查流式响应丢包/截断问题。生产建议留空。 | |
| # DEBUG_SSE=true | |
| # ---------- 工具调用模拟(Tool Calling Emulation)---------- | |
| # ChatGPT Web 不原生支持 function calling。aurora 复刻 的 | |
| # <tool_call>{...}</tool_call> 文本协议:在 system prompt 中教模型按格式输出, | |
| # 流式响应中实时切分出 tool_calls。 | |
| # | |
| # TOOL_CALLING_ENABLED: 是否启用。默认 true(只要请求体里声明了 tools)。 | |
| # 设为 false / 0 / no 强制关闭(忽略 tools 字段)。 | |
| # 启用时强制 stream=false(sandbox 重试需要完整响应),返回非流式 ChatCompletion。 | |
| TOOL_CALLING_ENABLED=true | |
| # REFUSAL_RETRIES: 模型陷入"sandbox 拒绝"循环时的最大重试次数。 | |
| # 每次重试会在末尾追加 _retrySuffix 提示模型立即输出 <tool_call> 块。 | |
| # 仅在工具调用模式生效;默认 3。 | |
| REFUSAL_RETRIES=3 | |
| # DEBUG_TOOL_LOG: 设为文件路径后,把每次工具解析的详细 trace 写入该文件 | |
| # (输入 text、解析结果、tool_calls 等)。调试用,生产建议留空。 | |
| # DEBUG_TOOL_LOG=tool_debug.log | |