# 语音识别
30 个相关产品 · 中文解读 · 按热度排序
oohula
一款语音教练应用,通过听辨发音差异、角色扮演和错题追踪,帮助用户提升口语表达能力,适合语言学习者。
BeFree - Brain Dump
BeFree 通过语音输入“思维乱炖”自动分类为任务、日程、购物清单或笔记,无需手动填写表单,支持离线使用并跨设备同步,提升信息捕捉效率。
LiveQuill
Mac端实时AI语音转文字工具,支持会议与笔记的私有化、离线、即时语音输入,解决用户对语音输入隐私与响应速度的双重焦虑
Audar-ASR-V1
专为阿拉伯语设计的语音识别模型,支持方言和语码转换,解决主流ASR在阿拉伯语场景下的识别失效问题,服务阿拉伯语用户
hearless
Hearless 是中亚首个AI语音转文字平台,支持语音识别与手语学习,帮助听障人士实现沟通无障碍,填补区域AI无障碍服务空白。
Wavetype
Wavetype 利用Whisper模型实现音频视频转文字,支持98+语言、说话人识别与一键导出,快速生成高准确率文本内容。
Give your AI ears – live meeting transcripts over MCP on macOS
为 macOS 用户打造的实时会议转录工具,通过 MCP 协议将 AI 语音识别能力接入系统,实现会议中语音内容的即时转写与可搜索记录,适合远程协作团队和频繁开会的职场人士
Ikor — AI-powered writing assistant.
基于AI的写作助手,能理解用户本地口音、语气与意图,实现更自然、快速的语音输入与文本生成
Spoke
语音笔记应用,用户通过说话快速记录想法与任务,语音本地处理不上传,文本仅在登录后同步,保障隐私同时实现高效信息捕获
LiveLingo — Real-Time Voice Translator
LiveLingo 是实时语音翻译工具,支持自然对话节奏的双语交流,延迟仅约 1.5 秒,还可翻译传统电话通话。
cjpais/Handy
完全离线运行的开源语音转文字应用,基于 Rust 构建,支持自定义模型与扩展,保护用户隐私。
matthartman/ghost-pepper
完全在设备上运行的语音转文字与会议记录工具,支持 macOS 上的私密语音模型,无需上传音频数据
Beingpax/VoiceInk
macOS 上的开源语音转文字应用,媲美 Superwhisper 和 Wispr Flow,无需订阅即可实现高精度语音识别与实时转写。
Voxa AI
24小时不间断的AI语音接待员,可自动接听电话、理解用户意图并转达信息,适用于企业客服与个人助理场景。
openai/whisper
Whisper 是 OpenAI 开发的开源语音识别模型,能通过弱监督学习实现高鲁棒性的语音转文字,支持多语言和多种场景。
ggml-org/whisper.cpp
将 OpenAI Whisper 语音识别模型移植到 C/C++,实现轻量级、高性能的本地语音转文字工具,适合嵌入式或低资源环境使用。
Willow Frontier Pro
全球最快最精准的语音转文字模型,专为语音输入优化,提升写作与记录效率
Universal-3.5 Pro
AssemblyAI推出的Universal-3.5 Pro是目前最精准的语音转文字(STT)API,适用于开发者、内容创作者和企业,支持多语言、高准确率和实时处理,显著提升语音内
I replaced Whisper with Parakeet TDT on a $55/month CPU server
Parakeet TDT 是一个轻量级语音识别模型,可在仅 55 美元/月的 CPU 服务器上替代 Whisper,显著降低部署成本。
PURGE OS
一个零延迟、可自定义的语音转意图解析系统,专为追求极致响应速度的生产力工具设计
Volleyball Code
教练通过语音实时记录排球比赛数据的工具,无需手动输入,实现无接触、高效的数据采集。
kitlangton/Hex
一款将语音实时转为文字的 Swift 工具,适用于语音输入、会议记录、快速笔记等场景。
Audar-ASR-V1
Audar-ASR-V1 是首个开源的阿拉伯语优先语音识别模型,支持高精度阿拉伯语语音转文字,推动中东地区 AI 语音技术发展。
Notes: Transcribe Unlimited
语音转文字笔记应用,支持无限时长语音输入并自动转录,适合会议记录、灵感捕捉与知识管理场景。
LipRead AI
LipRead AI 是一款基于 AI 的唇读工具,可从无声视频中识别说话内容,适用于视频字幕生成、无障碍辅助等场景。
The First Open Source Diffusion ASR Audio Model 15x Faster Than Whisper
首个开源的扩散模型语音识别(ASR)系统,速度比 Whisper 快 15 倍,适合低延迟语音处理场景
ScribeKey
ScribeKey 是一款语音转文字工具,支持语音输入与粘贴,帮助用户快速将口语内容转为文本,适合需要高效记录或输入的创作者与办公人群,亮点是免安装、即时使用。
STT-MCP – local STT for agents
本地运行的语音识别系统(STT),专为 AI 代理设计,保障隐私与低延迟
Mumble Dictation – local dictation that learns your vocabulary
Mumble Dictation 是一个本地运行的语音转文字工具,能学习用户自定义词汇(如专业术语、人名),适合需要高准确率语音输入的创作者、程序员或残障用户,保护隐私且无需上传数
TranscriptGo
TranscriptGo 是一款高精度语音转写工具,特别擅长处理非英语语言,帮助用户准确记录会议、访谈等多语种内容