探索包含 voice-input 主题特性的所有开源仓库、扩展插件与智能体组件。
Web Speech API实现中英混合口述转写,无需额外依赖,在浏览器内实时识别并填充文本,兼顾口语自然切换,大幅简化网页端的语音录入操作。
安全版本地语音输入插件,依托同源宿主代理在127.0.0.1本地运行,token本地校验,集成SenseVoice-Small INT8 ONNX模型完成本地语音转写,全程音频数据不出本地网络,无隐私泄露风险,部署轻量开箱即用。
提供本地多语言语音识别与Codex Desktop听写能力,识别内容仅写入可编辑草稿,无需二次处理即可直接编辑使用。
支持将语音实时转写为文字输入到目标网页输入框,自动语音播报助手返回的回复内容,纯前端实现无任何第三方依赖,安装启用即可直接使用,无需额外配置。
浏览器原生SpeechRecognition接口实现的轻量化纯英文语音输入插件,可在输入框区域添加麦克风按钮,零依赖无额外子进程,交互轻快无需额外配置,开箱即用。
轻量语音输入插件,无需手动输入文本,点击麦克风即可唤起语音录入,识别准确率高,响应延迟低,适配主流浏览器,交互流畅自然,可快速集成至各类工具界面使用
依托云端ASR语音识别能力,支持语音输入自动生成优化提示词,可一键填入草稿或直接发送,适配macOS与Windows双平台,识别精准,操作轻便,无需手动输入即可快速完成内容转化。
多语言Whisper模型打造的本地语音转文字插件,无需上传音频至云端即可完成多语种语音识别转录,操作轻量,识别准确率高,开箱即用。
依托Parakeet与NeMo-Speech.cpp实现本地离线语音识别转写,可直接作为AI工具的语音输入源,无需网络连接即可完成高准确率语音输入,轻量低延迟适配桌面端日常使用。
浏览器侧语音转文字插件,点击麦克风即可完成聊天场景语音输入,本地处理无需额外配置,识别速度快准确率高,操作简单流畅。
轻量级实用插件,依托Edge-TTS能力实现,支持语音输入文本内容、自动朗读输出结果,无需复杂配置即可对接现有工具,交互自然顺畅。
轻量本地语音输入工具,依托端侧小语音模型实现离线语音转文字,无需上传音频至云端,低延迟响应,部署配置简单可直接接入日常工具链使用。