
イレブンラボジャパン合同会社は、医療分野向けの音声認識モデル「Scribe v2 Medical」を、バッチ処理のSpeech to Text APIで正式提供した。2026年5月から先行提供していたモデルで、診療中の会話、医療スクライブ、口述筆記、問診、医療機関間の連携に伴う通話などを対象とする。
診療音声をテキスト化し、記録作成サービスの基盤に
Scribe v2 Medicalは、汎用音声認識モデル「Scribe v2」を医療向けに追加学習したモデルだ。薬剤名、解剖、病理、臨床の口述筆記など、診療に関わる音声の認識精度を高めたとしている。
提供されるのは音声をテキストへ変換する機能であり、カルテや診療記録の文書自体を生成したり、診断・治療方針を判断したりするものではない。出力は、医療従事者など権限を持つ利用者が確認・修正したうえで使う想定としている。
医療AI企業は、このモデルを基盤として自社の記録作成サービスや診療支援製品を構築できる。
臨床音声3,619件で単語誤り率7.0%
公開ベンチマーク「Eka Medical ASR」の臨床音声3,619件を用いた評価では、単語誤り率は7.0%だった。比較対象のScribe v2は8.6%、Scribe v1は18.6%であり、正確性の向上を示す結果となった。
医療AI企業Nablaによる第三者評価では、実際には話されていない医療用語を書き足す現象が起きた割合は0.4%で、Scribe v2の0.7%を下回った。一般会話音声6,000件のテストでは、Scribe v2と同じ5.3%だった。これらは発表内で示された評価結果であり、医療従事者による出力確認を前提とするとしている。

HIPAA対応には契約とZRMの有効化が条件
HIPAAに対応した形で利用するには、エンタープライズ契約の顧客がBAA(Business Associate Agreement)を締結し、Zero Retention Mode(ZRM)を有効化する必要がある。ZRMを有効にしたリクエストでは、処理完了直後に入力音声と出力テキストが削除される。文字起こしデータを利用者側のシステムが受け取った後の保存・管理は、利用者側が担う。
医療機関が同モデルを基盤とするサービスを検討する場合は、音声認識後の文書作成範囲、医療従事者による確認・修正の手順、利用契約とデータ保持設定を分けて確認する必要がある。
出典
- 情報元:PR TIMES/Eleven Labs Japan合同会社
- 掲載日:2026年10月1日
- 記事名:イレブンラボ、医療分野向けの音声認識モデル「Scribe v2 Medical」の正式提供を開始

医療機関向けの情報発信を行う一般社団法人 DOC TOKYOの編集部門として、クリニック運営・医療業務・医療ITに関する情報を調査・編集しています。
医療機関やサービス提供事業者への取材、公開情報の確認、製品・サービス情報の整理を通じて、医療現場の実務と経営判断に役立つ比較・検討材料を提供しています。
- メルマガで最新情報に簡単アクセス
クリニック経営に役立つ最新情報をお届け! - 開業に役立つ記事・動画が見放題
DOCWEB限定動画や厳選された情報で、円滑な開業準備をサポート! - クリニックに合った製品・サービスがすぐに見つかる
手間なく、効率的に情報収集。DOCWEBならではの充実した比較・検討が可能! - 気になる製品・サービスの資料を無料ダウンロード
詳細情報をすぐに確認でき、納得の選択ができる!
