何が起きたか
ChatGPTのリリースノートに、10月6日付で「Audio uploads in ChatGPT」が載った。音声ファイルを会話に添付すると、文字起こし、録音の要約、中身についての質問ができる。会議・インタビュー・講義を、構造化したメモやフォローのメール下書きにする使い方が例に挙がっている。詳しい条件は英語のヘルプにまとまっている。
- 対象: 有料のサブスクリプションとワークスペース。英語のヘルプには、無料プランは「現時点では対象外」とある
- 形式: WAV、MP3、M4A、FLAC、AAC、音声のみのWebM・MP4など。動画として判定されるWebM・MP4は使えない
- サイズ: 512MBまで。長い録音は、Data Analysisが使える場合に小分けで処理されることがある。処理はベストエフォートで、とても長いとタイムアウトしうる
- 注意書き: 文字起こしには誤りがあり、話者の識別は当てにならないことがある。大事な点は元の録音で確かめるよう書かれている。言語によって性能も変わりうる
- 提供の差: ワークスペースの設定、地域、クライアントのバージョン、モデルで変わりうる
Macの会議録音プラグインは別の機能で、以前の記事で書いた。こちらは手元の録音ファイルを添付する形だ。
生活で何が変わるか
学校の説明会、PTA、先生や園との面談の録音から、要点とやることを拾う使い方が考えられる、というのは私の想像で、試してはいない。所要時間や精度の体感は、自分で使っていないので書けない。
日本で使えるかは、英語のヘルプとリリースノートには書かれていない。日本語のヘルプ(機械翻訳と表示された「ファイルアップロード FAQ」)には、音声の記述が見当たらなかった。英語のヘルプでは、保持やデータ利用の節は見出しが書類と画像向けなので、音声にそのまま当てはまるかは確認できていない。
マスターの一言
人の声を録音する時は、相手に一言断ってからにしたい。使えるかどうかは、自分のプランと画面で確かめるのが確実だと思う。
