探索包含 agent-skills 主题特性的所有开源仓库、扩展插件与智能体组件。
轻量级视觉插件,融合图像理解与光学字符识别能力,自动提取图片中的文字、物体与场景,输出结构化结果,接口简洁,调用灵活,可顺畅集成至智能体工作流。
把PaddleOCR封装成AI可调用的原生工具,提供图形化界面配置参数,实现多语言文字识别、版面分析与图像文本提取,让模型调用更简单顺畅。
粘贴半成品想法、参考笔记或作品集说明,自动生成结构化开发计划、技术拆解和资产列表,助力3D艺术家、技术设计师和创意编码者快速将模糊构思落地为可执行方案。
内置42项技能与5个命令行工具,一站式管理AI代理资产。覆盖LLM工程、评估驱动与规格驱动开发,支持MySQL、PG、Redis等主流数据库操作,单个插件即可接入现有工作流。
支持粘贴图片到任意会话,纯文本也可触发视觉理解与生成。内置GLM/Qwen/Gemini多模型故障切换,输出采用ModLens结构。
自动解析软件界面与操作流程,生成结构化导航地图,AI代理执行任务前可快速熟悉环境,减少盲目试错,提升操作准确性与任务完成效率。
CLI-first vision sidecar for text-only coding agents. Analyze screenshots, diagrams, charts, UI diffs, and videos with O...
支持三线表、图题表题自动编号、页码页眉等学术排版规范,把Markdown文档直接输出为符合期刊要求的Word文件,保留结构化格式,减少手工调整。
AI代理的深度阅读工具,自动抽取并关联文章、书籍和PDF中的观点声明与支撑证据,呈现置信度评分和动态知识图谱,让证据溯源与知识脉络一目了然。
免安装免费使用,粘贴图片即可识别问答,支持多图连续提问、长截图OCR与前端UI还原,为纯文本模型补上视觉理解与定位能力。
自动抓取全球主流新闻源,实时聚合国际热点、突发新闻与市场分析,输出结构化摘要和趋势研判,帮助开发者快速掌握全球动态并集成到自有应用。
提供Sealos AI技能集,支持自然语言一键部署任意项目、创建数据库与对象存储,兼容Claude Code、Gemini CLI与Codex,让AI代理直接完成云资源编排与交付。