
TongueType
TongueType 是一款完全本地化、离线运行的 macOS 语音输入应用。它使用 Whisper AI 模型在 Apple 芯片上运行,无需联网、无需账户、无需订阅。只需按住快捷键说话,文字即刻出现。永久免费,可选择一次性购买 Pro 版。
Text Expansion发现最强大的 语音识别 AI 工具,包括 DefinedCrowd、MiMo、ELSA Speak、Transkriptor、Lingvanex、AssemblyAI、Speak、SoundHound AI、iFlytek Spark、Krater.ai,以及其他相关工具。

TongueType 是一款完全本地化、离线运行的 macOS 语音输入应用。它使用 Whisper AI 模型在 Apple 芯片上运行,无需联网、无需账户、无需订阅。只需按住快捷键说话,文字即刻出现。永久免费,可选择一次性购买 Pro 版。
Text Expansion
MiMo是小米推出的先进大模型AI工具,旨在通过深度理解语言和感知物理世界来重新定义智能。它作为智能伙伴,提供预测性协助、创意生成,并促进人机无缝协作。
Largelanguagemodels

一款由人工智能驱动的语言学习平台,通过个性化的故事驱动课程帮助用户学习英语、法语、西班牙语等语言。它配备了人工智能导师、实时反馈、语音识别以及从A1到C1级别的CEFR对齐内容。
企业培训



VoiceGecko 是一款桌面应用程序,提供即时、高精度的语音转文本听写功能。它几乎兼容所有应用程序,允许用户通过语音进行输入,从而节省时间、减少拼写错误并改善工作流程,尤其适合开发人员和 AI 用户。
消息

DefinedCrowd是一家领先的高质量AI训练数据提供商。它利用全球众包力量为机器学习模型收集、标注和丰富数据,专注于语音、自然语言处理和计算机视觉领域。它提供全托管服务,帮助企业大规模构建稳健且无偏见的AI应用。
机器学习
Speech Studio 是微软 Azure 提供的一套功能全面的 AI 工具,使开发人员能够构建具有高级语音功能的应用程序。它提供高精度的语音转文本、听感自然的文本转语音、实时语音翻译和说话人识别功能。用户可以创建自定义语音模型和对话式界面,使其成为适用于各种语音解决方案的多功能平台。
文本转语音


OpenVoiceOS 是一个由社区驱动的开源语音 AI 平台,用于创建自定义、私密且安全的语音控制界面。它可在树莓派和 Linux 桌面等各种硬件上运行,为开发者和 DIY 爱好者提供了一个灵活的、基于插件的架构。
语音与语音


voice_vector 是一个功能强大的人工智能语音平台,提供高保真声音克隆、富有表现力的文本转语音(TTS)和精准的语音识别功能。凭借其独特的“按量付费”与订阅混合模式,它为内容创作者、开发者和企业提供了灵活且经济高效的解决方案。您可以创建无限的私人克隆声音,并通过强大的API将高级语音功能集成到您的项目中。
文本转语音



讯飞星火是科大讯飞推出的综合性AI助手和大型语言模型平台。它在深度推理、多模态交互和语言理解方面表现卓越,支持超过130种语言。该平台提供一套完整的工具,包括对话式AI、AI搜索、开发者API和模型即服务(MaaS)平台,为个人用户和教育、医疗、金融等行业的企业赋能。
写作
Accent Guesser 是一款由人工智能驱动的工具,它能通过分析您的声音来精准识别您的口音。利用先进的深度学习技术,它能即时提供关于您语音模式和语言背景的洞察。对于语言学习者、科技爱好者和充满好奇心的用户来说,这是一个有趣且引人入胜的方式,可以探索全球口音并提升沟通技巧。只需在网站上录制您的声音,几秒钟内即可发现您口音的独特之处。
语音分析
FileTranscribe 是一款免费的人工智能工具,可快速准确地转录音频和视频文件。它提供说话人识别、自动摘要和会议纪要生成等高级功能,是学生、专业人士和内容创作者轻松将语音转换为文本的理想选择。
语音转文本