ElevenLabs、リアルタイム音声対話統合機能「Speech Engine」を提供開始
音声AIリサーチと技術のグローバルリーダーであるElevenLabs(本社:米国ニューヨーク州、CEO:Mati Staniszewski 以下「イレブンラボ」)は、企業が自社で構築・運用する大規模言語モデル(LLM)やチャットエージェント、会話システムに、イレブンラボの最高水準の音声生成技術をダイレクトに統合できる新機能「ElevenLabs Speech Engine」の提供を開始しました。
### 開発の背景:既存資産を音声インターフェースへ
ビジネス現場では「画面から音声へ」のシフトが進んでおり、コンタクトセンターや社内ヘルプデスクにおける音声AIエージェントへのニーズが高まっています。しかし、企業が既に運用しているFAQ、CRM、独自LLMなどを活かしながら音声対応を追加する場合、会話ロジックやセキュリティ、ガバナンスを維持したまま、リアルタイム音声対話を実装することには大きな課題がありました。これまでのフルパッケージ型の音声AI導入では、既存システムとの責任分界点が曖昧になり、導入のハードルとなっていました。
### 解決策としての「Speech Engine」
Speech Engineは、自社サーバー側で会話ロジック、業務システム連携、データ管理を制御したまま、ElevenLabsの音声認識・音声生成技術を組み込める開発者向け機能です。OpenAI互換のAPIを通じて、テキストベースの既存エージェントに音声対話機能を付加します。
### 主な特徴
1. **自社LLMとのシームレス接続**: OpenAI互換のChat Completions API等に対応。企業側でロジックを管理しながら音声化が可能。 2. **高度なリアルタイム応答**: ターンテイキング、割り込み検知など、自然な会話体験に必要な制御を実装。 3. **多言語対応**: 日本語を含む多言語で対話を実装可能。グローバル展開や訪日客対応にも対応。
イレブンラボジャパンの田村元ゼネラルマネージャーは、「既存システムの制御を維持したまま自然な音声体験を構築したいというニーズに対し、セキュリティを確保しながらElevenLabsの技術を統合できる」と語っています。ElevenLabsは現在、企業評価額110億ドルを超え、Fortune 500企業の多くに利用されています。
FACT BOX ・ 要点整理
- 出典:PR TIMES
- 分類:新製品
- 関連組織:ElevenLabs
- 製品・サービス:ElevenLabs Speech Engine