探索包含 llm 主题特性的所有开源仓库、扩展插件与智能体组件。
提供会话循环自诊断能力,基于会话事件日志开展确定性绕路检测,支持重放验证优化建议,自动沉淀已采纳的修复方案,无需人工排查即可快速定位会话流程异常。
的高保真双语递归压缩后端组件,支持多语言内容的多轮递归压缩,全程忠实保留原文语义与双语对应关系,压缩结果保真度高,可直接对接现有Harness工作流完成部署。
提供kimi-code、kimi-cn、kimi-global三条Kimi模型接入路由,支持流式响应、思维链输出、工具调用与图像输入,可快速将Kimi模型能力集成到应用开发场景中。
轻量级大模型调用成本管控插件,可自动完成LLM调用成本计量,支持按预算阈值设置拦截或告警规则,同时适配峰谷定价策略,灵活管控团队大模型调用开销。
dsh-retry-policy-settings DeepSeek Harness (DSH) 插件 · 模型重试策略设置 在 DSH Web 设置面板中可视化编辑每个模型提供方的 API 请求失败重试策略(retryPolicy)——重...
作为AI代理读取内容的锁与回放基元,支持内容寻址快照、读取新鲜度策略配置、单次运行清单生成、内容差异对比,可提供字节级精确回放能力,保障AI代理读取内容的身份稳定与可复现性。
动态Cordis轻量插件,实时读取当前调用的LLM API,在设置页直观展示当前总用量、分会话用量,同时支持扫描会话日志回溯历史用量数据。
支持自定义路由规则实现不同模型请求的智能分层调度,可灵活配置模型优先级与流量分配策略,无需复杂开发即可快速接入现有模型服务链路,降低多模型运维成本。
轻量级LLM API限流插件,支持细粒度限流、并发控制、FIFO队列、token额度管控与自适应429冷却,可自动处理接口限流逻辑,保障请求有序执行且不触发平台风控。
支持LLM调用token用量与成本实时统计,适配人民币峰谷计价规则,内置agent工具与HTTP API,数据持久化存储,配套可视化监控仪表盘,可直观查看不同时段调用开销与用量明细。
支持生成、校验与运行本地优先的确定性工作流,无需依赖云端服务即可完成全流程操作,结果稳定可复现,可覆盖开发调试、自动化任务等使用需求
编码会话工作区自动快照插件,每轮自动保存当前工作区状态,支持随时回滚到任意历史时间点,全程不会修改用户自有git仓库内容。