Audiototext

Googleの音声ツール

録音に合うGoogleの音声文字起こし方法は?

Googleで音声文字起こしを探すと、Googleドキュメントへの音声入力、対応デバイスのレコーダーでの文字起こし、Cloud Speech-to-Textを使った開発という、3つの異なる方法が見つかります。まずは音声がどこにあるか、必要なのが文書、録音の文字起こし、アプリへの組み込みのどれかを確認しましょう。

文字起こしサービスに進みます。
Audiototextのランディングページのビジュアル

目的は一つ、方法はいくつか

Googleのツールは、出発点によって使い分けられます。以下の関連記事では、別のアシスタント、編集ワークフロー、基本的な文字起こしの手順を比較できます。

文字起こし方法の選び方

重要なのはGoogleの名前ではなく、今話している内容を入力するのか、既存の録音を開くのか、アプリで音声を処理するのかという違いです。

会議の記録担当者

開いているGoogleドキュメントに、話しながらメモを入力したい場合。音声入力はマイクからの音声を聞き取る機能であり、汎用のファイルアップロード型音声文字起こしではありません。

ドキュメントにメモの下書きを作成し、名前、句読点、抜けている語句を修正しましょう。

リアルタイム音声文字起こし

対応デバイスの所有者

対応デバイスのGoogleレコーダーアプリに、すでに録音がある場合。文字起こし機能はデバイスや利用可能な設定によって異なります。

必要な形式で書き出せると思い込まず、まず録音の文字起こしを確認しましょう。

無料のオンラインmp3音声文字起こし

開発者

アプリ内で音声認識を使う場合や、音声を繰り返し処理する仕組みが必要な場合。Cloud Speech-to-TextはAPIであり、単純な音声入力ボタンではありません。

プロジェクトの設定、認証、対応する入力の要件、発生する可能性のある料金を確認しておきましょう。

ChatGPTは音声をテキストに変換できますか?

動画編集者

インタビューやメディア制作物を編集する際、編集を重ねても使いやすいテキストが必要です。文字起こしした文書だけでは、編集作業に対応しきれない場合があります。

ツールを選ぶ前に、文字起こし結果の編集と、メディア編集に特化した方法を比較しましょう。

DescriptのWeb版で音声をテキストに変換

手順:方法を選ぶ

  1. 1

    音声の入力元を確認する

    マイクに向かって話すなら、Google Docsの音声入力を検討しましょう。録音がすでに対応デバイスのRecorderにある場合は、そこで文字起こし結果を確認してください。アプリや自動化された作業で使う場合は、Cloud Speech-to-Textを調べましょう。

  2. 2

    要件を確認する

    使用する方法に応じて、デバイスが利用できるか、マイクへのアクセス権、ファイルと言語の対応状況、Cloudプロジェクトの設定を確認してください。この3つを、同じようにファイルをアップロードできるツールとして扱わないでください。

  3. 3

    文字起こし結果を確認する

    音声を聞きながら出力されたテキストを読みましょう。共有または公開する前に、名前、話者の発言が重なる箇所、専門用語、雑音で聞き取りにくい箇所を修正してください。

Google DocsとCloud Speech-to-Textの比較

この2つのGoogleの方法はいずれも音声をテキストにできますが、必要な入力と設定の程度が異なります。

Google Docsの音声入力
Google Cloud Speech-to-Text

主な用途

Google Docsの音声入力

文書に音声で入力する

Google Cloud Speech-to-Text

アプリケーションに音声認識機能を追加する

一般的な入力

Google Docsの音声入力

マイクで取り込んだ音声

Google Cloud Speech-to-Text

APIを使ったワークフローで提供される音声

開始方法

Google ドキュメントの音声入力

ドキュメントと使用可能なマイク

Google Cloud Speech-to-Text

設定済みの Cloud プロジェクトとアプリケーションコード

既存の録音

Google ドキュメントの音声入力

音声入力には、ファイルをアップロードして文字起こしする簡単な手順はありません

Google Cloud Speech-to-Text

サービスに提供された対応形式の音声を処理できます

出力先

Google ドキュメントの音声入力

編集中のドキュメントにテキストが表示されます

Google Cloud Speech-to-Text

音声認識の結果がアプリケーションに返されます

最適な用途

Google ドキュメントの音声入力

話した内容をメモとして書き起こす個人ユーザー

Google Cloud Speech-to-Text

繰り返し行う音声処理を管理する開発者

制限と注意点

Google のサービスを使えば、専用のアップロード・文字起こしページと同じ体験が自動的に得られるわけではありません。

Google ドキュメントは、あらゆるファイルに対応する変換ツールではありません

音声入力はマイクからの入力を前提に設計されています。録音をマイクの近くで再生しても、元の音声を直接入力する代わりとしては信頼できません。

代替方法

録音ファイルを受け付ける方法を使い、アップロード前に対応形式を確認してください。

Recorderはどこでも利用できるわけではありません

Recorderの機能や文字起こしの利用可否は、デバイス、言語、アプリのバージョンによって異なります。

代替方法

重要な録音に使う前に、お使いのデバイスで利用できる機能を確認してください。

Cloudの利用には実装が必要です

Cloud Speech-to-Textには設定が必要で、料金が発生する場合があります。文字起こしを1件だけ必要とする人には、最も手軽な方法ではありません。

代替方法

APIが必要な場合に利用し、そうでなければ音声を直接文字起こしする方法と比較してください。

自動生成されたテキストも確認が必要です

雑音、アクセント、専門用語、同時に話す声は、どの自動音声認識でも精度を下げる可能性があります。

代替方法

元の音声を残しておき、重要な箇所は聞き直して確認してください。

手元の音声から始めましょう

録音から使える下書きへ

Google固有の設定ではなく文字起こしが目的なら、Audiototextのリンク先の文字起こしサービスに進み、現在対応している入力方法を確認してください。完成版として使う前に、生成されたテキストを録音と照らし合わせて確認してください。

音声を文字起こしする
  • 対応する音声入力を確認する
  • 名前や聞き取りにくい箇所を確認する

Googleの音声文字起こしに関する質問

Googleには、Docsの音声入力、対応デバイスのRecorder機能、Cloud Speech-to-Textなど、音声をテキストに変換する方法が複数あります。それぞれ用途が異なるため、話しながら入力するのか、デバイスの録音を扱うのか、アプリケーションを構築するのかに応じて選んでください。

Google ドキュメントの音声入力はマイクからの入力を認識する機能で、音声ファイルをアップロードするための汎用機能ではありません。録音済みの音声を文字起こしする場合は、そのファイル形式に明示的に対応した方法を探してください。

いいえ。音声入力は話した言葉を文書に入力する機能ですが、Cloud Speech-to-TextはAPIを通じて音声を処理する開発者向けサービスです。Cloudの設定や料金が必要になる場合があります。

周囲の雑音、声の重なり、なじみのない名前、マイクの位置が適切でないことなどが認識精度に影響します。自動生成されたテキストを確認済みの記録として扱わず、元の音声を聞き直して重要な箇所を修正してください。

音声を文字起こし
音声を文字起こし