구글의 최고의 AI 모델에 직접 접근
개인적이고, 적극적이며, 강력한 AI 어시스턴트
일, 학교, 가정 작업에 대한 지원
글쓰기, 연구, 설명 및 콘텐츠 생성 능력
마이크 입력 지원
VoicePen, Voice Notes Extension, PlayAI, MyVocal.ai, Listnr AI, CoeFont, VoiceBar, Free Text to Speech Online, Speakatoo AI Text to Speech, DupDub are the best paid / free Voice-to-Text tools.






음성 인식, 또는 음성 인식이라고도 하는 음성 인식 기술은 말로 된 단어를 쓰인 텍스트로 변환하는 기술입니다. 1950년대로 거슬러 올라가는 오랜 역사가 있지만, 특히 딥 러닝과 신경망과 같은 AI의 최근 발전으로 그 정확도와 성능이 크게 향상되었습니다. 음성 인식은 다양한 기기와 애플리케이션에서 접근성, 생산성 및 사용자 경험을 향상시키는 필수 도구가 되었습니다.
핵심 기능
|
가격
|
사용 방법
| |
|---|---|---|---|
Google Gemini | 구글의 최고의 AI 모델에 직접 접근 | 사용자는 채팅을 저장하기 위해 로그인하여 제미니와 상호작용할 수 있습니다. 작문, 주제 조사, 설명 또는 랜딩 페이지와 같은 콘텐츠 생성 등 다양한 작업을 도와달라고 요청할 수 있습니다. 또한 마이크 입력을 지원하여 상호작용할 수 있습니다. | |
CapCut | 데스크탑 및 모바일을 위한 비디오 편집 | CapCut을 사용하려면 데스크탑이나 모바일 앱을 다운로드하거나 온라인 크리에이티브 스위트를 사용하십시오. 비디오 편집, 텍스트 음성 변환 또는 AI 비디오 생성과 같은 원하는 도구 또는 기능을 선택하고 화면의 지침을 따라 콘텐츠를 생성하고 편집하십시오. | |
QuillBot | 패러프레이징 도구 |
무료 $0 USD 매월 오류를 수정하고 작업을 강화하며 브레인스토밍에 도움을 줍니다. 125단어까지 패러프레이즈 가능, 2가지 모드로 패러프레이즈, 기본 문법 오류 수정, 기본 모드에서 텍스트 인간화, 기본 요약 생성, AI 감지(1,200단어)
| 사용자는 QuillBot의 인터페이스에 텍스트를 작성하거나 붙여넣고 '패러프레이즈' 버튼을 클릭하여 텍스트를 재작성할 수 있습니다. 플랫폼은 문법 검사, 요약, 인용 생성 등 다양한 도구를 제공하며, 각 도구는 해당 인터페이스를 통해 접근할 수 있습니다. |
ElevenLabs | 텍스트 음성 변환 |
무료 $0 매월 10k 크레딧/월
| 사용자는 플랫폼의 도구를 사용하여 텍스트에서 음성을 생성하고, 음성을 클론하고, 비디오에 더빙하고, 오디오북을 생성할 수 있습니다. 플랫폼은 개발자가 AI 오디오 기능을 자신의 제품에 통합할 수 있도록 API와 SDK를 제공합니다. 사용자는 음성을 선택하고, 직접 배달하며, 콘텐츠를 게시할 수 있습니다. |
Meshy | 텍스트 투 3D |
무료 $0 신용카드 등록 불필요
| Meshy는 텍스트나 이미지를 3D 모델로 생성해주는 3D AI 플랫폼입니다. 사용법은 다음과 같습니다: 시작하기 • https://www.meshy.ai 에서 회원가입 • 무료 티어 제공, 유료 플랜 시 더 많은 생성 및 다운로드 가능 주요 기능 • 텍스트 투 3D — 원하는 내용을 설명하고 3D 모델 획득 • 이미지 투 3D — 참조 이미지를 업로드하여 3D로 변환 • 텍스트 투 텍스처 — 기존 메쉬에 AI가 생성한 텍스처 적용 • AI 애니메이트 — 3D 캐릭터 리깅 및 애니메이션 생성 워크플로우 1. 모드 선택 (텍스트 또는 이미지 투 3D) 2. 프롬프트 입력 또는 이미지 업로드 3. 드래프트 미리보기 생성 (빠른 속도, 로우 폴리곤) 4. 리파인(Refine) → 텍스처가 입혀진 최종 모델 생성 5. GLB, FBX, OBJ, STL, USDZ 등의 포맷으로 다운로드 API 액세스 • REST API 지원 — API로 생성된 모델은 워크스페이스 UI에 나타나지 않습니다(의도적 설정). List Tasks API를 사용하여 결과물을 확인하세요. 문서: https://docs.meshy.ai |
TurboScribe | 오디오 및 비디오 전사를 텍스트로 변환 |
터보스크라이브 무료 무료 매일 3개 전사, 30분 업로드, 낮은 우선순위
| 오디오 또는 비디오 파일을 업로드한 후 오디오 언어를 선택하고 전사 모드(Cheetah, Dolphin, Whale)를 선택합니다. 필요에 따라 화자 인식 또는 오디오 복원 기능을 활성화합니다. 그런 다음 '전사하기'를 클릭하여 텍스트를 생성합니다. |
Perchance | 목록을 사용한 무작위 생성기 생성 | Perchance에서 무작위 생성기를 만들려면, 서로 참조하는 목록을 만듭니다. 예를 들어, '팩' 목록과 '아이템' 목록을 정의한 다음, 두 목록에서 무작위 아이템을 조합하는 출력을 생성할 수 있습니다. 아이템의 선택 확률을 조정하고, 다른 사용자의 생성기를 가져올 수도 있습니다. | |
ZeroGPT | AI 콘텐츠 검출 |
PRO 월 7.99달러 광고 없이 프로 경험을 즐기고, AI 검출당 100,000자, AI 검출을 위한 50개 배치 파일 체크, AI 검출을 위한 PDF 보고서 생성, 모든 검출 기록(텍스트는 포함되지 않음), ZeroCHAT-4에서 2,000개의 프롬프트 및 플래그리즘 검사기에서 한 번에 750단어, AI 요약기에서 1,500단어, AI 패러프레이저에서 300단어 재구성(2가지 모드 제공), AI 문법 및 철자 검사기에서 1,000단어, AI 번역기에서 500단어를 즐기세요.
| 사용자는 텍스트를 붙여넣거나 파일을 업로드하여 AI 생성 텍스트를 감지할 수 있습니다. 이 도구는 AI로 작성된 문장을 강조하고 AI 비율을 제공합니다. 다른 도구는 각각의 도구 인터페이스에 텍스트를 붙여넣거나 파일을 업로드하여 사용할 수 있습니다. |
Photoroom | 배경 제거 |
무료 무료 비용 없이 표준 제품 사진 생성
| 사용자는 모바일 장치에 포토룸 앱을 다운로드하거나 웹 앱을 사용할 수 있습니다. 이후 사진을 업로드하고 다양한 도구를 사용해 편집하고 향상시키며 최종 디자인을 내보낼 수 있습니다. |
OpenRouter | 다양한 LLM에 대한 통합 API | 계정을 만들고 크레딧을 구입한 후 API 키를 생성하고 OpenAI SDK를 사용하여 요청을 시작하세요. 사용 가능한 모델을 탐색하고 통합 인터페이스를 통해 접근하세요. |

AI 모델
AI 툴 디렉토리
AI API 개발
대형 언어 모델 LLMs
AI 챗봇
AI 음성 인식
AI 텍스트 생성기
AI 이미지 생성기
AI 이미지 인식
AI 보이스 생성기
AI 어시스턴트
의료 전문가들은 환자 노트와 기록을 음성 인식으로 작성하여 의료 문서 작성의 효율성과 정확성을 향상시킵니다.
저널리스트와 기자들은 인터뷰를 텍스트로 변환하고 오디오 소스에서 신속하게 글을 작성하기 위해 음성 인식을 사용합니다.
고객 서비스 센터는 고객 통화를 자동으로 텍스트로 변환하기 위해 음성 인식을 사용하여 분석 및 품질 보증을 개선합니다.
Siri, Google Assistant, Alexa와 같은 음성으로 작동하는 가상 비서는 사용자 명령을 이해하고 실행하기 위해 음성 인식을 의존합니다.
음성 인식 기술에 대한 사용자 평가는 일반적으로 점차적이며, 편리성, 속도 및 접근성의 혜택을 칭찬하는 사람들이 많습니다. 일부 사용자는 특정 사투리나 배경 소음에 대한 가끔의 부정확함이나 어려움을 보고하지만, 대부분은 기술이 최근 몇 년간 크게 향상되었다고 인정합니다. 많은 사용자들은 타자를 치는 대신 텍스트를 말할 수 있는 시간 절약 측면을 감사히 여기며, 장애가 있는 사람들이나 타자에 어려움을 겪는 사람들은 음성 인식을 소통과 생산성에 필수적인 도구로 생각합니다. 그러나 일부 사용자들은 클라우드 기반 음성 인식 서비스를 사용할 때의 개인 정보 보호와 데이터 보안에 대한 우려를 표명합니다.
학생들은 강의 중에 메모를 위해 음성 인식을 사용하여 타자 치는 것과 비교하여 시간과 노력을 절약합니다.
운동 장애가있는 개인은 음성 인식을 통해 이메일과 문서를 작성하여 효과적으로 소통할 수 있습니다.
운전자는 휠을 잡고 눈을 길게 하기 위해 음성 인식을 사용하여 안전하게 문자 메시지나 이메일을 보냅니다.
연구원은 음성 인식을 사용하여 레코드된 인터뷰를 빠르게 텍스트로 변환하여 내용을 분석하고 인용하는 것이 더 쉬워집니다.
음성 인식을 사용하려면 일반적으로 마이크가 장착된 기기와 음성 인식 소프트웨어 또는 API가 필요합니다. Windows, macOS, iOS, Android 등 대부분의 최신 운영 체제에는 내장된 음성 인식 기능이 있습니다. 시작하려면 텍스트가 표시될 응용 프로그램 또는 문서를 열고, 마이크 아이콘을 클릭하거나 키보드 단축키를 사용하여 음성 인식 기능을 활성화합니다. 명료하고 일정한 속도로 말하면 소프트웨어가 실시간으로 단어를 텍스트로 변환합니다. 일반적으로 문장 부호 및 서식에 대한 음성 명령을 사용할 수 있습니다.
장애가 있는 사람들이나 타자에 어려움을 겪는 사람들에 대한 접근성 향상
타자를 치는 것보다 빠르게 텍스트를 따라 말할 수 있어 생산성 향상
다양한 기기에서 백그라운드 입력을 통한 사용자 경험 개선
회의, 강의 또는 인터뷰의 효율적인 노트 작성 및 텍스트 변환
음성으로 작동하는 가상 비서 및 스마트 홈 기기 구현







































