标签主题词 (Topic)

# rate-limit

探索包含 rate-limit 主题特性的所有开源仓库、扩展插件与智能体组件。

dsh-peak-block
better-er

轻量级请求拦截工具,可自动识别DeepSeek官方在梁文峰相关时间节点的高峰请求并完成拦截,无需人工值守,部署后即可稳定运行,有效规避非预期时段的高并发访问。

提供LLM供应商配置模板,内置限流、重试机制的最佳实践方案,已完成SenseNova脱敏处理,可直接复用,快速完成多供应商接入的配置工作。

dsh-camel
JuwanXu

为相关服务提供提供者与模型感知的自适应限速调整、可见重试及免费模型自动恢复能力,简化多模型调用的流量管控与故障自愈流程,降低调用异常概率。

轻量级Web客户端插件,可自动向api.github.com的请求注入GitHub授权请求头,无需手动配置凭证即可规避共享IP下的API调用频率限制,开箱即用

支持自动重试失败的API请求,避免对话因接口异常中断,可自定义需要重试的状态码与错误码,配置简单无需修改业务代码即可适配各类常规接口调用,保障对话流程稳定连贯。

是轻量级请求重试插件,模型请求失败且错误信息命中预设关键词时,内置重试策略耗尽后仍可自动追加重试,配套设置面板支持灵活调整匹配关键词与退避参数,无需修改代码即可适配自定义重试规则。

dsh-auto-retry
Windsland52

有界后备恢复插件,不替换官方 @deepseek-ai/dsh-llm-retry,仅在官方重试策略结束后接手,处理中转方误标 429 为 QUOTA、模型请求无可见输出两类可恢复问题,仅在明确可恢复时触发重试,支持自定义重试次数、总等待时...

LLM流式调用限流插件,依托FIFO队列实现按提供商、模型维度的调用频率管控,支持最小调用间隔、最大并发数配置,可适配流式瀑布调用场景,轻量接入即可避免调用超限问题。

轻量级LLM API限流插件,支持细粒度限流、并发控制、FIFO队列、token额度管控与自适应429冷却,可自动处理接口限流逻辑,保障请求有序执行且不触发平台风控。

dsh-migrate-on-429
minyang2020

作为会话限流自动迁移插件,可在会话持续触发429 TPM限流时自动完成会话交接,自动取消旧会话、生成交接摘要,在新会话中无缝延续对话进度,无需手动处理限流导致的中断问题。