録音や動画を高精度に文字起こし
文字起こし技術「Whisper」を使って、音声ファイルまたは動画ファイルの音声を素早く正確に文字起こし(テキスト化)してくれます。
日本語を含む100以上の言語に対応。
生成された文字起こしは、テキストファイルのほかに字幕ファイル(.srt、.vtt)などに出力できます。
アプリ内課金で、会議の録音や話者検出、システム音声入力、複数ファイルの文字起こしなどに対応します。

【変更点】
■ 新機能
・ クラウド文字起こし:Cohere Transcribe および Speechmatics を追加しました。モデル、言語、
地域のオプションが含まれます。
・ Deepgram のプライバシー:Deepgram の「モデル改善プログラム」をオプトアウトするオプションを追加しました。このオプションは
デフォルトで有効になっています。
■ 改善点
・ AI モデル:Google Gemini および xAl Grok モデルを更新し、廃止された
モデルから自動的に移行するようになりました。
・ エクスポートオプション:バッチエクスポート、監視フォルダ
プリセット、カスタムプリセット、およびエクスポートサイドバーに、話者名、タイムスタンプ、ミリ秒単位の制御機能を追加しました。
・ クラウド文字起こし:各プロバイダーにおいて、信頼性、言語処理、およびエラーメッセージを改善しました。
・ プロバイダー設定:Cohere、Speechmatics、Corti、Cartesia、Avalon、および
Volcengine 専用のアイコンを追加しました。
・ キュー:失敗した項目について、進行状況が誤解を招くことなく、より明確なエラーが表示されるようになりました。
■ バグ修正
・ 修正:YouTubeのダウンロードでHTTP 403エラーが発生したり、空のファイルが生成されたりすることがなくなりました。
・ 修正:監視フォルダが、サポートされていないファイル形式を無視するようになりました。
・ 修正:文字起こしのエクスポートにおいて、サポートされていないタイムスタンプが表示されたり、行が省略されたり、単語グループ化された出力に不要なスペースが挿入されたりすることがなくなりました。
・ 修正:単語グループ化されたエクスポートにおいて、話者名が発言ターンごとに1回だけ表示されるようになりました。
・ 修正:OpenAl、Deepgram、Gladiaの結果に、空のトランスクリプトセグメントが表示されなくなりました。
・ 修正:ElevenLabsでタガログ語に対して正しい言語コードが使用されるようになりました。
・ 修正:エクスポートされたHTMLトランスクリプトで、正しいテキスト色が使用されるようになりました。
