浏览该开发者发布与维护的开源仓库、扩展插件与项目应用。
支持给纯文本模型新增视觉识别能力,采用类Codex聊天框拖拽交互,用户上传的图片会自动分流至已配置的视觉模型转文字,v4版本无需切换模型即可直接完成识图,操作流畅便捷。
作为dsh-vlm-bridge bundle插件,内置vision_analyze工具可让纯文本LLM代理调用SenseNova VLM读取图像内容,支持Schemastery配置与统一凭证管理,无需额外改造即可让纯文本模型实现图像理解。
为Sub2API、NewAPI的GPT路由集成网络检索能力,同时支持V2版本响应自动压缩,无需额外配置即可拓展GPT路由的联网检索与长响应精简能力。
依托Edge浏览器与豆包网页版能力,无需API Key即可实现通用图像识别,针对几何图、流程图、公式等数学建模类图像专项优化,支持不确定项澄清闭环,零成本获得高准确率识图结果。
为纯文本模型补充图像理解能力,提供analyze_image工具,支持调用GLM-4V-Flash、Qwen-VL等免费中文视觉API,也兼容任意OpenAI格式接口,接入简单
轻量扩展工具,可自动调用MiniMax VLM识别输入图片,将识别结果注入大模型上下文,让纯文本模型无需调整结构即可直接具备视觉理解能力,开箱即用。
集成实时行情、巴菲特式价值评分、风险雷达与机构共识功能,一站式覆盖A股投研全流程,数据实时更新,评分逻辑透明,无需切换多平台即可完成从标的筛选到风险排查的全链路研究。
轻量级对话分享插件,可自动生成带封面、摘要统计与章节排版的精美对话报告,支持导出为PNG图片、单HTML文件及PDF格式,内容适配多端可直接分享。
支持纯视觉识别驱动桌面自动化操作,内置SoM grounding视觉定位、Planner-Actor双模块协同执行、操作效果自动校验机制,配套预置技能库,无需复杂配置即可快速完成桌面任务自动化。
孪生路由架构的视觉补全工具,本地对接Ollama请求层支持原生图片直读,无云端依赖,无需额外配置即可为工具链提供低延迟本地视觉推理能力,兼容主流本地视觉模型
确定性数据剖析清洗校验工具,支持对多源结构化、半结构化数据执行全链路质量管控,自动完成特征统计、异常值清洗与规则校验,配置轻量,开箱即用。
支持KaleidoSphere数据库的快速解析与多维度分析,原生适配无需额外配置,可自动完成结构化数据统计、指标计算与结果可视化输出,轻量集成即可满足日常数据库分析需求。