你希望看到什么功能?
config.toml 中支持配置
[providers.oMLX]
request_timeout_ms = xxx
或
[models."oMLX/qwen3.8-27b"]
request_timeout_ms = xxx
用于控制模型返回超时,避免任务进行一段时间后,上下文变长导致中途开始不可用
补充信息
Kimi Code CLI 是一个很好的开箱即用的工具,但是套餐额度很尴尬,所以会有使用 Kimi Code CLI 连接本地部署的模型做一些简单任务的需求。目前已经适配了 lmstudio 等其他本地部署引擎并且可以正常使用,但是自部署模型在长上下文或复杂推理场景下耗时较长,单次请求经常需要数分钟才能返回。目前 CLI 似乎没有暴露“模型请求超时”的配置项,导致请求容易被内部超时中断,影响正常使用。
你希望看到什么功能?
config.toml 中支持配置
[providers.oMLX]
request_timeout_ms = xxx
或
[models."oMLX/qwen3.8-27b"]
request_timeout_ms = xxx
用于控制模型返回超时,避免任务进行一段时间后,上下文变长导致中途开始不可用
补充信息
Kimi Code CLI 是一个很好的开箱即用的工具,但是套餐额度很尴尬,所以会有使用 Kimi Code CLI 连接本地部署的模型做一些简单任务的需求。目前已经适配了 lmstudio 等其他本地部署引擎并且可以正常使用,但是自部署模型在长上下文或复杂推理场景下耗时较长,单次请求经常需要数分钟才能返回。目前 CLI 似乎没有暴露“模型请求超时”的配置项,导致请求容易被内部超时中断,影响正常使用。