探索包含 token-efficiency 主题特性的所有开源仓库、扩展插件与智能体组件。
提供上下文内容感知瘦身、无效日志自动清理能力,支持工作流与记忆钉扎保护,默认先归档后压缩,可灵活配置摘要模型,开箱即用降低上下文管理成本。
模拟人类记忆机制的无状态对话压缩方案,无需会话管理即可对LLM对话历史智能精简,永久规避上下文溢出问题,使用过程无需额外状态维护。
依托飞轮机制自动匹配最优模型,在保障推理响应质量的前提下减少无效Token消耗,轻量易集成,无需复杂配置即可快速接入现有模型调用链路。
轻量级Agent上下文Token优化工具,可自动压缩上下文中的冗余内容,完整保留核心语义,同时输出详细的压缩统计报告,每分Token节省都可追溯,降低上下文成本且不影响Agent运行效果。
支持单次扫描摸清网页系统运作逻辑,自动抓取真实接口与可访问性树并固化为可复用的侦察手册,纯零依赖实现,无需Playwright环境即可快速部署使用。
开发者的token高效工程阅读插件,内置符号与导入索引、修改时间自愈机制、字节切片读取能力及成本探测功能,可快速定位工程代码资源,降低项目读取的token开销。
支持多提供商Agent的会话、配额与Token用量可视化分析,内置热力图、成本追踪、Token计数等功能,可快速定位用量异常,帮助优化token消耗成本,操作直观易用。
压缩Agent无效上下文、推理及输出内容,以尉缭子十原则约束权限边界与执行流程,配套Unicode编码、搜索规范与六类任务模式,提升运行效率同时保障输出规范性。
Stateless dialogue compression that mimics human memory. LLM conversations stay bounded forever — no session management,...