探索包含 JavaScript 主题特性的所有开源仓库、扩展插件与智能体组件。
直接上传或粘贴图片,自动调用 OpenAI 兼容视觉 API 生成英文描述,随后将描述喂给纯文本模型继续推理。轻量桥接层,让不具备视觉能力的模型也能读懂图片内容。
为纯文本模型按需识图:DSH 零补丁 Cordis 插件(prism_see 工具 + 图片 VEP 降级 + 技能运行时注册)+ Codex Skill;多 Provider 视觉 API,VEP/1 低 Token 视觉证据包
右侧栏内嵌文件浏览器,目录树采用懒加载策略,按需请求子节点,支持文本、图片、JSON等格式即时预览,并提供文件名搜索过滤,方便在Web界面中快速定位文件,交互流畅。
内置免费且低成本的视觉语言模型预设,让纯文本模型直接获得图像理解能力,支持一次提交多张图片批量分析,轻量接入即可扩展多模态功能。
提供右侧停靠文件树,支持代码、文本、图片、音视频、PDF一键预览;新增工作区自动停靠,窄屏下自动切换为响应式抽屉,提升文件浏览效率。
展示API余额、每日花费、外部视觉调用、按模型统计与调用日志,同时呈现缓存率和TTFT指标,并可将明细一键导出为CSV,方便本地分析与长期追踪。
轻量级视觉桥接模块,将图像特征转换为文本模型可理解的表征,无需额外训练即可获得图像理解能力,支持接入现有纯文本推理流程,保持原有性能的同时扩展多模态输入。
为纯文本模型接入视觉能力,通过视觉模型自动解析图片内容并转化为文本输入。采用表面替换机制,不修改原始对话记录,缓存友好,保持人类可读的交互流程。
支持自定义视觉、翻译、语音等专业代理并各自绑定独立模型,多模态账号一键登录,账号池健康路由与实时用量统计,让任务自动分派给最合适的模型。
支持PDF文本层提取、Office文字抽取、扫描件OCR识别,长文档自动拆分成索引卡,图片统一转PNG,让网页端附件内容直接完整可用。
输入自然语言需求,自动匹配插件生态,并附上可直接执行的安装命令。省去记插件名和翻文档的麻烦,一句话完成从查找到安装的闭环。
Native vision, gpt-image-2 and Seedance plugins for DeepSeek Harness via Xiapan Cloud