イレブンラボ、医療向け音声認識モデル「Scribe v2 Medical」を正式提供

イレブンラボ、医療向け音声認識モデル「Scribe v2 Medical」を正式提供

イレブンラボジャパン合同会社は、医療分野向けの音声認識モデル「Scribe v2 Medical」を、バッチ処理のSpeech to Text APIで正式提供した。2026年5月から先行提供していたモデルで、診療中の会話、医療スクライブ、口述筆記、問診、医療機関間の連携に伴う通話などを対象とする。

診療音声をテキスト化し、記録作成サービスの基盤に

Scribe v2 Medicalは、汎用音声認識モデル「Scribe v2」を医療向けに追加学習したモデルだ。薬剤名、解剖、病理、臨床の口述筆記など、診療に関わる音声の認識精度を高めたとしている。

提供されるのは音声をテキストへ変換する機能であり、カルテや診療記録の文書自体を生成したり、診断・治療方針を判断したりするものではない。出力は、医療従事者など権限を持つ利用者が確認・修正したうえで使う想定としている。
医療AI企業は、このモデルを基盤として自社の記録作成サービスや診療支援製品を構築できる。

臨床音声3,619件で単語誤り率7.0%

公開ベンチマーク「Eka Medical ASR」の臨床音声3,619件を用いた評価では、単語誤り率は7.0%だった。比較対象のScribe v2は8.6%、Scribe v1は18.6%であり、正確性の向上を示す結果となった。

医療AI企業Nablaによる第三者評価では、実際には話されていない医療用語を書き足す現象が起きた割合は0.4%で、Scribe v2の0.7%を下回った。一般会話音声6,000件のテストでは、Scribe v2と同じ5.3%だった。これらは発表内で示された評価結果であり、医療従事者による出力確認を前提とするとしている。

HIPAA対応には契約とZRMの有効化が条件

HIPAAに対応した形で利用するには、エンタープライズ契約の顧客がBAA(Business Associate Agreement)を締結し、Zero Retention Mode(ZRM)を有効化する必要がある。ZRMを有効にしたリクエストでは、処理完了直後に入力音声と出力テキストが削除される。文字起こしデータを利用者側のシステムが受け取った後の保存・管理は、利用者側が担う。

医療機関が同モデルを基盤とするサービスを検討する場合は、音声認識後の文書作成範囲、医療従事者による確認・修正の手順、利用契約とデータ保持設定を分けて確認する必要がある。

出典

  • 情報元:PR TIMES/Eleven Labs Japan合同会社
  • 掲載日:2026年10月1日
  • 記事名:イレブンラボ、医療分野向けの音声認識モデル「Scribe v2 Medical」の正式提供を開始