編集部では、日常的に発生する「60分間の複数名参加型ブレインストーミング」を模した録音環境を構築し、従来の手作業と最新のAIソリューションによる作業工程を徹底比較した。検証環境には、発話の重複、タイピング音、適度な環境雑音が含まれている。
結果は明白だった。手作業で音声を聞き直してテキスト化し、体裁を整える従来の手法では、60分の音声に対して平均148分の作業時間を要した。聞き取りにくい部分の巻き戻しや、専門用語の確認に時間を取られるからだ。
一方、最新のAI文字起こしエンジンと要約機能を連携させたフローでは、初稿のテキスト生成に約3分、誤字脱字の確認と関係者への共有用フォーマット整形を含めても、わずか13分で完了した。実質91.2%の時間削減である。単にテキストが並ぶだけでなく、話者ごとの発言意図や決定事項が箇条書きで自動抽出されるため、人間側の役割は「確認と微修正」へと完全にシフトした。