标签主题词 (Topic)

# token-optimization

探索包含 token-optimization 主题特性的所有开源仓库、扩展插件与智能体组件。

anolisa
alibaba

轻量级Agentic OS,集成运行时调度、安全策略与全链路可观测性,内置无Token响应压缩,直接降低token消耗,让智能体运行更省、更稳、更透明

作为动态token压缩插件,可智能削减请求token用量,不损失模型输出智能,配置简单即插即用,降低大模型调用成本同时保持原有交互体验。

dsh-nightshift
mikasaxin529

队列调度插件,支持高峰期暂存排队大模型推理任务,夜间低峰时段自动批量执行,自带费用节省报告生成能力,接入简单,降低推理成本。

trcost-plugin
VioletScar-Hui

提供会话轨迹token浪费分析能力,依托waterfall执行层实现无效请求的强制拦截与截断,减少不必要的token消耗,优化轨迹运行成本。

提供确定性、可恢复的工具结果压缩能力,支持缓存感知压缩,适配常规工具调用流程,稳定压缩工具返回结果不丢失数据,在优化token占用的同时保障结果可回溯

dsh-tool-squeeze
w2829562572-dev

提供证据保留型工具输出压缩能力,采用确定性压缩算法,优先本地运行无需上传数据,经过基准测试验证,可在不丢失关键输出信息的前提下压缩输出体积,降低存储与传输开销。

A token-efficient persona runtime for DeepSeek Harness. 把人格留在界面,把智能留给模型。Measured: -67% input tokens, -66% cache reads, 0...

dsh-dcp
chiro2001

DeepSeek Harness 动态上下文管理插件(Dynamic Context Pruning for dsh),对标 opencode-dcp

dsh-sleev
xarleyn

集成Sleev能力,支持路由感知的LLM调用遥测采集,同时提供上下文优化的可观测能力,可清晰追踪LLM请求链路,快速定位上下文损耗问题,降低大模型应用调试成本。

把长文本渲染为图片发送,单张图最高可压缩出384 token的大模型输入量,作为插件可直接对接大模型交互工具,无需调整原有操作流程即可降低长文本输入时的token消耗。

支持对大模型工具返回结果做Token高效裁剪,可生成紧凑结果预览、支持精准定向召回,支持长会话上下文管控,保留关键信息同时降低上下文Token消耗,适配长任务交互场景。

轻量级Agent上下文Token优化工具,可自动压缩上下文中的冗余内容,完整保留核心语义,同时输出详细的压缩统计报告,每分Token节省都可追溯,降低上下文成本且不影响Agent运行效果。