# 语音识别
共 4 款工具
千音漫语 - AI配音 千音漫语是集智能配音、多语言翻译配音、声音克隆及语音识别于一体的AI声音创作平台,提供1200+AI主播和全球100多种语言支持,满足专业声音处理与短视频创作需求。 FunASR - End-to-End Speech Recognition Toolkit - 高效语音识别 FunASR 是一款工业级端到端语音识别工具包,支持 50+ 语言,GPU 上可达 170 倍实时率,并提供说话人分离、情感检测与 OpenAI 兼容 API 等能力。 百度AI开放平台 百度AI开放平台提供语音、图像、NLP等人工智能技术及行业解决方案。 MP3ToText 【产品简介】 MP3 to Text(mp3totext.io)是一款面向全球用户的在线 AI 语音转文字工具,帮助用户将 MP3、WAV、M4A、MP4 等音频/视频内容快速转换为可编辑、可搜索的文本。无需安装软件,打开浏览器即可使用。 【核心功能】 · 免费在线转录:访客可直接试用;注册后可保存历史记录,并获得更高每日额度 · 文件上传:上传本地 MP3、WAV、M4A、MP4 等音视频文件,即可开始转录 · 多格式支持:兼容 MP3、WAV、M4A、FLAC、MP4、MOV、WebM 等常见音视频格式 · 150+ 语言识别:支持自动检测或手动选择音频语言 · 时间戳与说话人识别:生成带时间轴的结构化文稿,便于定位与引用 · AI 智能增强:可生成内容摘要、思维导图,帮助快速理解长录音 · 在线编辑:支持段落编辑、全文搜索与替换,便于校对和修改 · 多格式导出:支持 TXT、PDF、DOCX、CSV、SRT、VTT 等格式,满足字幕、文档、研究笔记等需求 · 字幕生成:可生成 SRT/VTT 字幕文件,适用于视频创作与后期制作