Macのポッドキャスト文字起こしと字幕
Macでポッドキャストを文字起こしするには、Apple Podcastsでエピソードのトランスクリプトを開きます。なければLive CaptionsをComputer Audioにします。使ってよい音声ファイルはテキストかSRTで書き出せます。
要点
- まずエピソード自身のトランスクリプトを探します。Apple PodcastsでView Transcriptを選び、段落をクリックするとそこから再生されます。
- トランスクリプトがなければLive Captionsをオンにし、Computer Audioにします。AppleのガイドではApple siliconのMacのみです。
- 手元に残すタイムスタンプ付きの文字起こしは、使ってよい音声ファイルを文字起こしします。Vocenaでは有料です。
このページの内容
Apple Podcastsでポッドキャストの文字起こしを読む
Macでポッドキャストを文字起こしするとき、すべてのエピソードにトランスクリプトがあるわけではありません。AppleのMacのPodcastsでエピソードのトランスクリプトを読むガイドでは、言語、国、地域によって、使える場合と使えない場合があります。エピソードにあれば、再生中に開くことも、View Transcriptから開くこともできます。
- MacのPodcastsでエピソードを開きます。
- トランスクリプトの欄を探すか、View Transcriptを選びます。
- 必要な箇所を読みます。段落をクリックすると、そこから再生されます。
- 単語やフレーズでトランスクリプトを検索します。Whole WordとMatch Caseで結果を絞れます。
検索で見つかるのは文字だけです。人名が正しく書き起こされているかは分かりません。覚えている言い回しが出てこないときは、その近くの特徴的な単語で検索し、見つかった前後を聞いてみてください。箇所が分かったら、エピソードのタイトルと再生位置を控えてください。あとからその位置に戻れます。人の発言を引用する前にも、もう一度聞いてください。
View Transcriptがないとき
番組の公式サイトかショーノートに、配信元が公開したトランスクリプトがないか見てください。第三者のサイトは、許諾がない場合もあり、内容が正確でない場合もあります。
どこにもないときは、Live Captionsで再生に合わせて読みます。編集できるファイルが必要なら、音声ファイルに進んでください。
ポッドキャストアプリで「downloaded」と出ていても、他のアプリが開ける音声ファイルとは限りません。取り込む予定なら、その前に、実際にアクセスできるものと、配信元が許可しているものを確認してください。

トランスクリプトがないエピソードはLive Captionsで読む
AppleのMacのLive Captionsガイドでは、対象はApple siliconのMacのみで、使える言語と地域も限られます。オンにすると、エピソードの再生中、フローティングウインドウに文字が出ます。初めてオンにしたときは、macOSが言語データをダウンロードします。準備にはインターネット接続が必要です。それ以降は、AppleがMac上で音声を処理します。
- Apple menu → System Settings → Accessibility → Live Captionsを選びます。
- オンにして、言語データのダウンロードが終わるまで待ちます。
- メニューバーのLive Captionsコントロールで、Computer Audioを選びます。
- 誰かが話している部分を再生し、新しい文字が出るか見ます。
- フローティングウインドウの位置と大きさを変え、プレーヤーの操作部が隠れないようにします。
Computer Audioは、Macで再生されている話し声向けです。Microphoneは、部屋の中の話し声向けです。スピーカーの音をマイクが拾っているだけで字幕が出ても、Computer Audioが動いているかどうかは分かりません。
音声が何も入っていないと、ウインドウは隠れます。設定中はKeep Onscreenをオンにして、何が起きているか見えるようにし、字幕が一時停止していないか確認します。フォント、サイズ、色は変えられます。
近くの人の声は拾うのに、ポッドキャストのプレーヤーは拾わないことがあります。静かな区間でウインドウが消え続けることもあります。そのときは、こちらのMacのLive Captionsトラブルシューティングで、音源ごとの確認表を順に見てください。
二つのプレーヤーを比べるときは、自分で録音した短いクリップか、使用を許可された短いクリップを一つ使います。変える条件は一度に一つです。Mac、macOSのバージョン、音源、プレーヤー、文字がまったく出なかったのか、誤った文字だったのかを書き留めます。別のブラウザ、保護されたストリーム、別の言語へ切り替えるときも、そこで短いクリップを再生します。
Appleのガイドには、Live Captionsの精度は変わることがあり、リスクの高い状況や緊急時には頼るべきではない、とも書かれています。人名や引用する予定の箇所は、巻き戻して聞いてください。
Vocenaのフローティング字幕ウインドウ
Mac版のVocenaには、macOS 15.5以降が必要です。特定のブラウザやポッドキャストアプリの音を拾えるかは、普段使うプレーヤーで試します。システムオーディオを取り込み、デスクトップのフローティングウインドウに字幕を出します。リアルタイムの字幕は無料です。時間制限はありません。音声認識はMac上で行われます。リアルタイム字幕のクラウド認識はサブスクリプションに含まれ、音声がアップロードされます。
各行は、マイクかシステムオーディオかにラベルが付きます。話者のラベルは付かないので、ホストとゲストが別人としては出ません。話者を分ける必要があるときは、Qwenのローカルモデルでファイルを文字起こしします。
- Vocenaで音源をシステムオーディオにしてから、聞き取りを開始します。自分で開始するまで、Vocenaは字幕を出しません。
- macOSが表示する許可に応じます。音声の取り込みと無関係な許可は与えないでください。
- 普段聴いているプレーヤーで、使ってよい短いクリップを再生し、フローティングウインドウに新しい字幕が出るか確認します。
- 終わったら聞き取りを停止します。Vocenaは自動では止まりません。
文字が出ないときは、音源がシステムオーディオになっているか、クリップに話し声が入っているかを確認します。クリップがファイルになっているなら、別のプレーヤーで試します。
音声ファイルとして手元にあるポッドキャスト
自分で録ったインタビューや、配信元がエピソードのファイルダウンロードを認めている場合は、VocenaのLibraryで文字起こしできます。ファイルの文字起こしは有料です。買い切りかサブスクリプションのどちらかが必要です。
- VocenaでLibraryを開き、音声ファイルを取り込みます。VocenaはそのファイルをMacにコピーします。
- 文字起こしモデルと時間の範囲を選び、文字起こしを開始します。マイクはオンになりません。処理はバックグラウンドで進みます。
- 文字起こしを開きます。Qwenのローカルモデルでは、行が話者ごとに分かれます。話者名の変更、話者の統合、人数を指定した分け直しができます。Appleの音声認識では、話者は分かれません。
- どの行でもクリックすると、そこから音声が再生されます。
- 読んで手を入れるならプレーンテキスト、別のツールがタイムスタンプ付き字幕を求めるならSRTを書き出します。
標準では、VocenaはMac上で音声を認識します。ライブラリもデバイス上に残ります。音声やテキストがアップロードされるのは、クラウドモデルを選んだときだけです。非公開の録音を開く前に、選ばれているモデルを確認してください。サインイン、モデルのダウンロード、クラウド機能の利用には、インターネット接続が必要です。
録音と文字起こしを照らし合わせる
最初の文字起こしは下書きとして扱います。元の音声ファイルと、どこから入手したかのメモは残してください。
話者に人の名前を付ける前に、音声を聞いてください。自動で分かれたまとまりは、誰がその言葉を話したかの証明にはなりません。相手の話にかぶるときや、背景に話し声があるときは、特にそうです。音声で確認できてから、話者名を変えるか、話者を統合してください。
引用する予定の人名、専門用語、文は、行をクリックして再生します。聞いてもまだ判断できないときは、ノートに未確認と書いておきます。
書き出したファイルを、実際に使うツールで開きます。冒頭、中盤、終盤から数か所を音声と聞き比べてください。エラーなく保存できていても、句読点、話者ラベル、タイムスタンプは確認します。
iPhoneとiPadの場合
VocenaはiPhoneとiPad向けの一つのアプリでもあり、iOSまたはiPadOS 26以降で使えます。iPhoneで他のアプリの音声に字幕を付けるには、iOS 27を搭載した実機が必要です。そこではデスクトップのウインドウではなく、ピクチャインピクチャで、他のアプリの上に字幕が浮かびます。

