会議の記録担当者
開いているGoogleドキュメントに、話しながらメモを入力したい場合。音声入力はマイクからの音声を聞き取る機能であり、汎用のファイルアップロード型音声文字起こしではありません。
ドキュメントにメモの下書きを作成し、名前、句読点、抜けている語句を修正しましょう。
リアルタイム音声文字起こしGoogleの音声ツール
Googleで音声文字起こしを探すと、Googleドキュメントへの音声入力、対応デバイスのレコーダーでの文字起こし、Cloud Speech-to-Textを使った開発という、3つの異なる方法が見つかります。まずは音声がどこにあるか、必要なのが文書、録音の文字起こし、アプリへの組み込みのどれかを確認しましょう。
Googleのツールは、出発点によって使い分けられます。以下の関連記事では、別のアシスタント、編集ワークフロー、基本的な文字起こしの手順を比較できます。
重要なのはGoogleの名前ではなく、今話している内容を入力するのか、既存の録音を開くのか、アプリで音声を処理するのかという違いです。
開いているGoogleドキュメントに、話しながらメモを入力したい場合。音声入力はマイクからの音声を聞き取る機能であり、汎用のファイルアップロード型音声文字起こしではありません。
ドキュメントにメモの下書きを作成し、名前、句読点、抜けている語句を修正しましょう。
リアルタイム音声文字起こし対応デバイスのGoogleレコーダーアプリに、すでに録音がある場合。文字起こし機能はデバイスや利用可能な設定によって異なります。
必要な形式で書き出せると思い込まず、まず録音の文字起こしを確認しましょう。
無料のオンラインmp3音声文字起こしアプリ内で音声認識を使う場合や、音声を繰り返し処理する仕組みが必要な場合。Cloud Speech-to-TextはAPIであり、単純な音声入力ボタンではありません。
プロジェクトの設定、認証、対応する入力の要件、発生する可能性のある料金を確認しておきましょう。
ChatGPTは音声をテキストに変換できますか?インタビューやメディア制作物を編集する際、編集を重ねても使いやすいテキストが必要です。文字起こしした文書だけでは、編集作業に対応しきれない場合があります。
ツールを選ぶ前に、文字起こし結果の編集と、メディア編集に特化した方法を比較しましょう。
DescriptのWeb版で音声をテキストに変換マイクに向かって話すなら、Google Docsの音声入力を検討しましょう。録音がすでに対応デバイスのRecorderにある場合は、そこで文字起こし結果を確認してください。アプリや自動化された作業で使う場合は、Cloud Speech-to-Textを調べましょう。
使用する方法に応じて、デバイスが利用できるか、マイクへのアクセス権、ファイルと言語の対応状況、Cloudプロジェクトの設定を確認してください。この3つを、同じようにファイルをアップロードできるツールとして扱わないでください。
音声を聞きながら出力されたテキストを読みましょう。共有または公開する前に、名前、話者の発言が重なる箇所、専門用語、雑音で聞き取りにくい箇所を修正してください。
この2つのGoogleの方法はいずれも音声をテキストにできますが、必要な入力と設定の程度が異なります。
主な用途
Google Docsの音声入力
文書に音声で入力する
Google Cloud Speech-to-Text
アプリケーションに音声認識機能を追加する
一般的な入力
Google Docsの音声入力
マイクで取り込んだ音声
Google Cloud Speech-to-Text
APIを使ったワークフローで提供される音声
開始方法
Google ドキュメントの音声入力
ドキュメントと使用可能なマイク
Google Cloud Speech-to-Text
設定済みの Cloud プロジェクトとアプリケーションコード
既存の録音
Google ドキュメントの音声入力
音声入力には、ファイルをアップロードして文字起こしする簡単な手順はありません
Google Cloud Speech-to-Text
サービスに提供された対応形式の音声を処理できます
出力先
Google ドキュメントの音声入力
編集中のドキュメントにテキストが表示されます
Google Cloud Speech-to-Text
音声認識の結果がアプリケーションに返されます
最適な用途
Google ドキュメントの音声入力
話した内容をメモとして書き起こす個人ユーザー
Google Cloud Speech-to-Text
繰り返し行う音声処理を管理する開発者
Google のサービスを使えば、専用のアップロード・文字起こしページと同じ体験が自動的に得られるわけではありません。
音声入力はマイクからの入力を前提に設計されています。録音をマイクの近くで再生しても、元の音声を直接入力する代わりとしては信頼できません。
代替方法
録音ファイルを受け付ける方法を使い、アップロード前に対応形式を確認してください。
Recorderの機能や文字起こしの利用可否は、デバイス、言語、アプリのバージョンによって異なります。
代替方法
重要な録音に使う前に、お使いのデバイスで利用できる機能を確認してください。
Cloud Speech-to-Textには設定が必要で、料金が発生する場合があります。文字起こしを1件だけ必要とする人には、最も手軽な方法ではありません。
代替方法
APIが必要な場合に利用し、そうでなければ音声を直接文字起こしする方法と比較してください。
雑音、アクセント、専門用語、同時に話す声は、どの自動音声認識でも精度を下げる可能性があります。
代替方法
元の音声を残しておき、重要な箇所は聞き直して確認してください。
Google固有の設定ではなく文字起こしが目的なら、Audiototextのリンク先の文字起こしサービスに進み、現在対応している入力方法を確認してください。完成版として使う前に、生成されたテキストを録音と照らし合わせて確認してください。
音声を文字起こしするGoogleには、Docsの音声入力、対応デバイスのRecorder機能、Cloud Speech-to-Textなど、音声をテキストに変換する方法が複数あります。それぞれ用途が異なるため、話しながら入力するのか、デバイスの録音を扱うのか、アプリケーションを構築するのかに応じて選んでください。
Google ドキュメントの音声入力はマイクからの入力を認識する機能で、音声ファイルをアップロードするための汎用機能ではありません。録音済みの音声を文字起こしする場合は、そのファイル形式に明示的に対応した方法を探してください。
いいえ。音声入力は話した言葉を文書に入力する機能ですが、Cloud Speech-to-TextはAPIを通じて音声を処理する開発者向けサービスです。Cloudの設定や料金が必要になる場合があります。
周囲の雑音、声の重なり、なじみのない名前、マイクの位置が適切でないことなどが認識精度に影響します。自動生成されたテキストを確認済みの記録として扱わず、元の音声を聞き直して重要な箇所を修正してください。