The Decoder· Jonathan Kemper·· 2 日前
ElevenLabs、音声モデル Eleven v4 とリアルタイム音声エージェント向け Turbo 版を公開
ElevenLabs' new v4 speech model makes AI voices more expressive and consistent
AI による要約
ElevenLabs は Eleven v4 を公開した。脚本中の感情、間、効果音タグにより正確に従い、長い制作物でも声質を一貫させる。新アーキテクチャは Turbo 版にも使われ、公式テストでは約150ミリ秒で音声出力を開始した。Cartesia Sonic 3.6 の262ミリ秒、OpenAI GPT-4o mini TTS の814ミリ秒と比較されている。
入選の記録
基準 76メディアと個人1 回目 782 回目 71
入選せず二回の合計 149 < 基準の 2 倍 152
- 情報源の区分
- メディアと個人、この区分の基準は 76 点
- 予備審査
- 通過:ElevenLabs发布AI语音模型v4
採点はモデルが同じ基準で独立に二回行い、満点は 100。二回の合計が基準の 2 倍に届いたものだけが入選します。基準は情報源の区分ごとに決めています。
情報源:The Decoder · the-decoder.com