リリース
音声だけで、議事録に発言者の名前が入る|いきなり議事録「話者分離3.0」

Ko Ohashi

AI議事録サービス「いきなり議事録」の話者分離を、「話者分離3.0」として新しくしました。音声だけの会議データでも、誰が話したかに加えて、その人の名前まで議事録に入るようになります。
これまでの課題
これまでの話者分離では、発言者は「話者A」「話者B」のように表示されていました。誰の発言なのかは、議事録を見ながら手で名前に置き換える必要がありました。
話者分離3.0の仕組み
話者分離3.0では、次の2つの仕組みで発言者の名前を付けます。
1. 声で同じ人だとわかる
監視カメラの分野には、人が柱の陰に隠れて、また現れても、同じ人だと見分ける「人物再識別(Re-ID)」という技術があります。この考え方を声に応用しました。
会議の途中で黙っていた人や、席を外して戻ってきた人も、声から同じ人だとまとめます。とくに、参加者の多い会議で効果が大きく出ています。
2. 会話から名前を判断する
会議では「佐藤さん、どう思います?」のように、名前で呼びかける場面がよくあります。こうした会話の流れを言語モデルで読み取り、「話者B」ではなく「佐藤」と表示します。
名前が付くのは、会話から分かる範囲です。
ご利用にあたって
動画内のデモは、合成音声で作った架空の会議です。実際の会議では、いつも100%正確に名前が付くわけではありませんが、これからも改善を重ねていきます。ぜひお試しください。
いきなり議事録:https://editor.shabelab.com
Windows Hello が WebAuthn の PRF 拡張に対応しました。ただし登録時の prf.enabled は false を返すため、このフラグで判定すると Windows ユーザーを取りこぼします。実機検証の結果と、get() で対応を確かめる実装パターンを紹介します。

面接の録音・録画は採用の質を高める重要な仕組みです。評価の公平性向上やトラブル防止、面接官教育、AI議事録による文字起こし・要約の自動化まで、5つのメリットと法律・個人情報の注意点をわかりやすく解説します。
