探索包含 voice 主题特性的所有开源仓库、扩展插件与智能体组件。
支持授权绑定的单轮语音交互,本地运行无需提供凭证,具备精准会话隔离能力,支持草稿直接交接,内置本地合成演示可直接体验,交互响应低延迟,流程简洁顺畅。
支持对智能体发起语音指令交互、接收语音反馈,同时提供始终置顶的悬浮窗实时展示智能体运行状态,无需切换当前工作窗口即可随时查看进度与输出内容。
轻量级语音播报插件,监听会话的turn/end事件,自动提取内容生成自然流畅的语音播报,部署无需额外依赖,支持多类语音包切换,使用过程无需手动干预。
DeepSeek Harness 语音插件:火山 seed-tts 云端 TTS(自动回退 SAPI/Huihui 离线)+ 桌面通知 + 场景化 WAV 提示音 + 提问自动呼叫。DSH 原生集成,零 Python 依赖,Windows ...
轻量级语音输入插件,支持实时语音转写为文本输入,安装配置简单,兼容主流输入框架,日常内容录入、写作时调用便捷,朗读功能仍在持续优化迭代。
流式zipformer2实现语音识别,支持生成可编辑对话草稿,可自定义唤醒词,搭配Edge TTS按句朗读并同步输出实时字幕,支持开口打断交互,无需API Key即可使用。
本地语音听写插件,调用本地语音识别模型完成麦克风语音转写,搭配Kokoro TTS引擎自动播报助手响应,全程本地处理无需上传数据,交互自然顺畅。
提供网页端内容自动朗读能力,可智能识别跳过代码块与表格内容,默认采用免费浏览器本地TTS,也可切换豆包云TTS获得更自然的朗读效果,开箱即用无需额外配置。
轻量级语音网关插件,可对接HTTP文本输入接口,自动将接收到的文本转为语音回复,支持电话线路直接接入调用,无需复杂配置即可快速搭建语音交互通道。
提供带麦克风按钮的语音会话循环能力,支持浏览器本地及本地部署的语音转写(Web Speech、FunASR、whisper.cpp),内置文本转语音工具,可直接搭建纯语音交互的会话流程。
适配DeepSeek Harness的第三方Fish Audio语音合成插件,可逐条朗读回复内容,支持自动朗读开关切换,需用户自行提供Fish Audio API密钥使用。
输入框右下角集成麦克风按钮,支持浏览器原生、讯飞、本地Whisper三种转写引擎,可自选麦克风设备、自动调整增益,采用液态玻璃风格设计,语音录入便捷顺畅。