1. Home
  2. News
  3. 音声AIのElevenLabs、Eleven v4とv4 Turboを公開しリアルタイム向けモデルで推論遅延約100ミリ秒を実現
2026/09/29

Startup Portfolio

音声AIのElevenLabs、Eleven v4とv4 Turboを公開しリアルタイム向けモデルで推論遅延約100ミリ秒を実現

ElevenLabsは、新しい音声生成モデルEleven v4と低遅延版のEleven v4 Turboを公開しました。両モデルは従来とは異なる新しいアーキテクチャを採用し、Eleven v4は表現力と音声品質を重視する用途、v4 Turboは音声AIエージェントなどリアルタイム性が必要な用途を主な対象とします。v4 Turboについて同社は、推論遅延の中央値が約100ミリ秒、最初の音声が出るまでの時間が約150ミリ秒としています。

両モデルは90以上の言語に対応し、文章の意味だけでなく、トーン、話す速さ、感情、キャラクター、前後の文脈を解釈して音声を生成します。「笑う」「ささやく」といった発話表現や効果音などをスクリプト内のタグから指定でき、複数話者の会話や長文での話者の一貫性も改善しました。Instant Voice Cloneでは10秒程度の音声から声を再現でき、より高い再現性を求めるProfessional Voice Cloneにも対応します。Eleven v4とv4 TurboはElevenCreative、ElevenAgents、ElevenAPIで利用できます。

第三者のArtificial Analysisが実施するブラインド方式のProvider Voice TTS Arenaでは、公開時点でEleven v4がElo 1319で首位となり、CartesiaのSonic 3.6やGoogleのGemini 3.8 Flash TTSを上回りました。同評価は利用者による音声の選好を基にするもので、投票の蓄積に伴い順位や数値は変動します。ElevenLabs自身の比較試験でも高い選好率を報告していますが、こちらは同社による測定です。v4では品質と表現力、Turboでは応答速度を分けて最適化したことで、コンテンツ制作とリアルタイム会話の双方に同じ世代の音声技術を展開する構成となっています。


ElevenLabsについて
ElevenLabsとは、2022年にPiotr DąbkowskiとMati Staniszewskiが共同創業した生成AI企業です。音声合成から事業を開始し、現在は音声変換・複製、吹き替え、効果音、音楽生成、会話型AIなどへ事業を広げています。主力基盤は企業向けのElevenAgents、クリエイター向けのElevenCreative、開発者向けのElevenAPIです。ロンドン、ニューヨーク、ワルシャワなどを主要拠点としてグローバルに事業を展開しています。言語や声の違いを越えてコンテンツへアクセスでき、技術とのコミュニケーションや創作を自然に行える環境を目指しています。

 

TagsAIUnited States

関連ニュース

Contact

AT PARTNERSにご相談ください