
TongueType
TongueType은 100% 로컬, 오프라인 macOS 음성 입력 앱입니다. Apple 실리콘에서 Whisper AI 모델을 로컬로 실행하여 클라드, 계정, 구독이 필요 없습니다. 단축키를 누르고 말하면 단어가 즉시 나타납니다. 영구 무료이며, Pro 업그레이드를 선택할 수 있습니다.
Text ExpansionDiscover powerful 음성 인식 AI tools, including DefinedCrowd, MiMo, ELSA Speak, Transkriptor, Lingvanex, AssemblyAI, Speak, SoundHound AI, iFlytek Spark 및 Krater.ai, and other related products.

TongueType은 100% 로컬, 오프라인 macOS 음성 입력 앱입니다. Apple 실리콘에서 Whisper AI 모델을 로컬로 실행하여 클라드, 계정, 구독이 필요 없습니다. 단축키를 누르고 말하면 단어가 즉시 나타납니다. 영구 무료이며, Pro 업그레이드를 선택할 수 있습니다.
Text Expansion
MiMo는 샤오미의 고급 대규모 AI 모델로, 깊은 언어 이해와 실제 물리적 세계 인식을 통합하여 지능을 재정의하도록 설계되었습니다. 지능형 동반자 역할을 하며 예측 지원, 창의적 생성 기능을 제공하고 원활한 인간-기계 협업을 촉진합니다.
Largelanguagemodels

AI 기반 언어 학습 플랫폼으로, 개인화된 스토리 중심 커리큘럼을 사용하여 사용자가 영어, 프랑스어, 스페인어와 같은 언어를 배울 수 있도록 돕습니다. AI 튜터, 실시간 피드백, 음성 인식 및 A1부터 C1까지의 CEFR 연계 콘텐츠를 제공합니다.
기업 교육



VoiceGecko는 즉각적이고 정확도 높은 음성-텍스트 받아쓰기 기능을 제공하는 데스크톱 애플리케이션입니다. 거의 모든 앱에서 작동하여 사용자가 음성으로 입력함으로써 시간을 절약하고 오타를 줄이며 작업 흐름을 개선할 수 있도록 돕습니다. 특히 개발자와 AI 사용자에게 이상적입니다.
메시징

DefinedCrowd는 고품질 AI 학습 데이터를 제공하는 선도적인 기업입니다. 글로벌 크라우드를 활용하여 머신러닝 모델을 위한 데이터를 수집, 주석 처리 및 보강하며, 특히 음성, NLP, 컴퓨터 비전 분야에 특화되어 있습니다. 기업이 대규모로 견고하고 편향 없는 AI 애플리케이션을 구축할 수 있도록 완벽한 관리형 서비스를 제공합니다.
기계 학습
Speech Studio는 Microsoft Azure에서 제공하는 포괄적인 AI 기반 도구 모음으로, 개발자가 고급 음성 기능이 포함된 애플리케이션을 구축할 수 있도록 지원합니다. 매우 정확한 음성 텍스트 변환, 자연스러운 텍스트 음성 변환, 실시간 음성 번역 및 화자 인식 기능을 제공합니다. 사용자는 맞춤형 음성 모델과 대화형 인터페이스를 만들 수 있어 다양한 음성 지원 솔루션에 다용도로 활용할 수 있는 플랫폼입니다.
텍스트 음성 변환


OpenVoiceOS는 맞춤형, 비공개 및 보안 음성 제어 인터페이스를 만들기 위한 커뮤니티 주도형 오픈 소스 음성 AI 플랫폼입니다. Raspberry Pi 및 Linux 데스크톱과 같은 다양한 하드웨어에서 실행되며 개발자와 DIY 애호가를 위한 유연한 플러그인 기반 아키텍처를 제공합니다.
음성 및 언어


voice_vector는 고품질 음성 복제, 표현력이 풍부한 텍스트 음성 변환(TTS), 정확한 음성 인식을 제공하는 강력한 AI 음성 플랫폼입니다. 독특한 종량제 및 구독 하이브리드 모델을 통해 콘텐츠 제작자, 개발자, 기업에 유연하고 비용 효율적인 솔루션을 제공합니다. 무제한의 개인 복제 음성을 만들고 강력한 API를 통해 고급 음성 기능을 프로젝트에 통합하세요.
텍스트 음성 변환



iFlytek Spark는 iFlytek이 개발한 포괄적인 AI 어시스턴트 및 대규모 언어 모델 플랫폼입니다. 심층 추론, 멀티모달 상호작용, 130개 이상의 언어를 지원하는 언어 이해 능력에 뛰어납니다. 이 플랫폼은 대화형 AI, AI 검색, 개발자 API, 미세 조정을 위한 서비스형 모델(MaaS) 플랫폼을 포함한 도구 모음을 제공하여 개인 사용자뿐만 아니라 교육, 의료, 금융 등 다양한 산업의 기업을 지원합니다.
글쓰기
Accent Guesser는 인공지능 기반 도구로, 사용자의 목소리를 분석하여 놀라운 정확도로 억양을 식별합니다. 고급 딥러닝 기술을 사용하여 발음 패턴과 언어적 배경에 대한 즉각적인 통찰력을 제공합니다. 언어 학습자, 기술 애호가, 그리고 호기심 많은 개인들이 전 세계의 억양을 탐색하고 의사소통 기술을 향상시키는 재미있고 매력적인 방법입니다. 웹사이트에서 목소리를 녹음하기만 하면 몇 초 안에 자신의 억양의 독특한 특징을 발견할 수 있습니다.
음성 분석
FileTranscribe는 오디오 및 비디오 파일을 몇 분 안에 정확하게 텍스트로 변환하는 무료 AI 기반 도구입니다. 화자 분리, 자동 요약, 회의록 생성과 같은 고급 기능을 제공하여 음성을 텍스트로 손쉽게 변환하려는 학생, 전문가, 콘텐츠 제작자에게 이상적입니다.
음성 텍스트 변환