音頻和視頻轉錄為文字
支持98種以上語言
無限制的轉錄服務
說話者識別
內建翻譯功能
多種匯出格式(PDF、DOCX、SRT、TXT)
音頻修復工具
Talk to ChatGPT, Capacity Conversational AI Software, VoiceVector, Babylon Voice, VoiceAINote, VoiceGPT, Voice Notes Extension, Voice Master, Talkingvet® Chrome Extension, Chrome Extension: Speech Recognition & Text-to-Speech 是最好的付費/免費 voice recognition tools.






語音識別是一項技術,使得電腦能夠理解和解釋人類的語音。自上世紀50年代以來,它已存在,但近年來隨著人工智能和機器學習的崛起有了顯著進步。語音識別現在廣泛應用於各種應用中,從虛擬助手到無障礙功能。
核心功能
|
價格
|
如何使用
| |
|---|---|---|---|
TurboScribe | 音頻和視頻轉錄為文字 |
TurboScribe Free 免費 每日3份逐字稿,30分鐘上傳,較低優先級
| 上傳音頻或視頻檔案,選擇音頻語言,選擇轉錄模式(獵豹模式、海豚模式或鯨類模式),如有需要可啟用說話者識別或音頻修復。然後,點擊'轉錄'以生成文字。 |
Adobe Podcast | AI驅動的音訊增強 | 雖然完整產品仍在等候名單中,Adobe Podcast目前提供兩種免費的簡易工具:一是 '增強語音' 用來去除背景噪音和回音,二是 '麥克風檢查' 以優化麥克風音質。完整平台將允許用戶直接在網頁上錄製、轉錄、編輯及分享音訊。 | |
Freed | AI驅動的醫療抄寫員 |
試用 免費 7天免費試用,無限次就診
| 使用Freed時,請在病人就診開始時選擇「捕捉就診」。AI抄寫員會聆聽、轉錄並撰寫筆記。就診後,編輯筆記並將其複製/貼上到你的EHR中。 |
Deepgram | 語音轉文字 API | 免費試用 $200 的免費信用金 可用於轉錄 750 小時,或生成約 200 小時的文字轉語音音訊,無需信用卡。 | 使用 Deepgram 的方式是,先註冊一個免費帳戶以獲得 $200 的免費信用金。探索 Playground 來試用模型和 API,轉錄範例音訊檔案,或生成文字轉語音音訊。將 Deepgram 的 API 整合進你的應用程式中,以實現語音轉文字、文字轉語音及語音代理功能。 |
Voicemaker | 文字轉語音轉換 |
免費計劃 $0 用於測試
| 將文字粘貼到文本框中,選擇 1,000 多種 AI 語音和 130 種語言,然後自訂語音設置,便可轉換為超真實的語音。以 MP3 和 WAV 格式下載 TTS 音頻文件。 |
Krisp | 人工智能噪音消除 |
免費 $0 美元 適合個人使用,提供會議紀錄和噪音消除。主要功能:無限文字轉錄及音頻錄音、每天 60 分鐘噪音消除、每天 60 分鐘口音轉換、每天 2 次 AI 紀要和行動項目、7 天會議歷史、僅限英語的文字及摘要。
| Krisp 可與各種通訊應用集成。安裝後,Krisp 將自動消除背景噪音、錄音、轉錄和總結會議及通話。用戶可以通過 Krisp 界面或集成平台調整設定並訪問功能。 |
AssemblyAI | 語音轉文字 |
免費 免費 以50美元的免費點數開始構建
| 用戶可以利用 AssemblyAI 的 API 轉錄預錄的語音數據,構建低延遲串流語音轉文字的語音代理工作流程,並使用音訊智慧模型進行深入分析。該平台還提供無需代碼的實驗場以測試 AI 模型。 |
Tarteel AI | AI驅動的朗誦跟隨 |
免費 $0 探索您可以在 Tarteel AI 上做的事情。無廣告,免費永遠!
| 對著應用程式朗誦可蘭經經文,Tarteel AI 將提供即時反饋,標示出單字並識別錯誤。 |
AnyToSpeech | 文本轉語音轉換 |
免費 $ 0 /月 約 15 秒音頻,200 字元,每天 1 音頻,商業用途:否,帶有 'Created with AnyToSpeech' 標語
| 用戶可以通過貼上文本、上傳 PDF、DOCX 或 TXT 文件,選擇喜好的聲音和風格,然後點擊「創建你的音頻」來將文本轉換為音頻。音頻可以直接在瀏覽器中收聽或下載為 MP3 文件。 |
Zeemo | 自動生成字幕 |
免費 $0 /月 無水印,10積分,字幕視頻長度最多為1分鐘,720P輸出
| 使用Zeemo的方法是,先上傳視頻,然後按下「字幕」按鈕以添加、翻譯或編輯字幕,最後導出完整字幕的視頻或SRT字幕檔。Zeemo可以通過瀏覽器或應用程式使用。 |
醫療保健: 醫生使用語音識別口述病人註釋並簡化醫療記錄。
法律: 律師和法律助理使用語音識別來轉錄訪談,證詞和法庭訴訟。
客戶服務: 呼叫中心採用語音識別來自動化客戶互動,並減少等待時間。
汽車: 在汽車中整合語音識別以實現對導航,音樂和其他功能的無手控制。
對語音識別技術的用戶評論通常是正面的,許多人讚揚其便利性和準確性。一些常見的優點包括無手操作,節省時間和提高可訪問性。然而,一些用戶報告在嘈雜環境或某些口音下的準確性問題。其他人對隱私和安全性表示擔憂,特別是在使用基於雲端服務時。
使用像Siri或Alexa這樣的虛擬助手設置提醒,提出問題或控制智能家居設備。
在智能手機上口述消息或郵件而不是打字。
在汽車中使用語音控制導航以實現更安全的駕駛。
實時轉錄會議或講座以便更輕鬆地記筆記。
要使用語音識別,通常需要麥克風和語音識別軟件。該軟件聆聽您的語音,分析聲波,並將其與已知單詞和短語的數據庫進行匹配。然后根據識別的單詞將語音轉換為文本或執行命令。許多設備,如智能手機和智能揚聲器,都具有內置的語音識別功能。
與設備進行無手操作,讓用戶可以同時進行多項任務。
改善殘障人士或行動受限者的可訪問性。
與在移動設備上輸入相比,較快的輸入速度。
增強用戶體驗和方便性。







































