本文へ移動
原文
The Decoder· Jonathan Kemper·· 2 日前

ElevenLabs、音声モデル Eleven v4 とリアルタイム音声エージェント向け Turbo 版を公開

ElevenLabs' new v4 speech model makes AI voices more expressive and consistent

AI による要約

ElevenLabs は Eleven v4 を公開した。脚本中の感情、間、効果音タグにより正確に従い、長い制作物でも声質を一貫させる。新アーキテクチャは Turbo 版にも使われ、公式テストでは約150ミリ秒で音声出力を開始した。Cartesia Sonic 3.6 の262ミリ秒、OpenAI GPT-4o mini TTS の814ミリ秒と比較されている。

入選の記録

入選せず二回の合計 149 < 基準の 2 倍 152

情報源の区分
メディアと個人、この区分の基準は 76 点
予備審査
通過:ElevenLabs发布AI语音模型v4

採点はモデルが同じ基準で独立に二回行い、満点は 100。二回の合計が基準の 2 倍に届いたものだけが入選します。基準は情報源の区分ごとに決めています。

情報源:The Decoder · the-decoder.com