探索包含 output-limit 主题特性的所有开源仓库、扩展插件与智能体组件。
当本地模型输出达到token上限时,自动发送“continue”指令,无需手动干预即可让回复持续输出,适配本地各类推理场景,使用流程更顺畅。