本文へ移動

AWS、SageMaker AI の vLLM-Omni で画像・動画・音声を生成

まずはこの出来事を

AI によるまとめ

2026年9月29日、AWS Machine Learning Blog は、SageMaker AI で vLLM-Omni DLC を使いマルチモーダル生成アプリを構築する二つのチュートリアルを公開した。1本目(第2部)では、同じ vLLM-Omni DLC イメージから二つのエンドポイントを構築する。リアルタイム側は FLUX.2-klein-4B で画像を生成し、非同期側は Wan2.1-VACE-1.3B で画像を条件とする動画を生成する。テキストプロンプトから PNG を生成し、動きのプロンプトとともに Amazon S3 経由で動画エンドポイントへ送り、最後に S3 から MP4 を取得する。例にはコマンドラインの手順と任意の Streamlit 画面が含まれる。2本目(前編)は Qwen3-TTS の構築を説明し、持続的な1本の双方向接続でテキスト入力と音声出力をストリーミングし、生成が終わる前に音声の再生を始める。

報道をもとに AI が作成 · 2 日前に更新

報道の時系列

報道をたどり、出来事のさまざまな面を知る。

9月29日
  1. AWS Machine Learning Blog
    SageMaker AIとvLLM-Omniのリアルタイム音声アプリ(上):Qwen3-TTSのストリーミング配置

    AWSはSageMaker AIにQwen3-TTSを配置できるvLLM-Omni DLCを公開した。持続的な双方向接続1本で文字を入力しながら音声を出力し、生成が完了する前から再生を始められる。

  2. AWS Machine Learning Blog
    SageMaker AIでvLLM-Omniによる画像・動画生成(第2部)

    AWSは、同じvLLM-Omni DLCイメージを使った2つのエンドポイントをSageMaker AIへ配置するチュートリアルを公開した。リアルタイム側はFLUX.2-klein-4Bで画像を生成し、非同期側はWan2.1-VACE-1.3Bで画像条件付き動画を生成する。テキスト指示からPNGを生成し、動きの指示とともにAmazon S3経由で動画側へ渡し、最終的にS3からMP4を取得する。例にはコマンドライン手順と任意のStreamlit画面を含む。

この出来事の注目度の推移

現在の注目度 3·比較範囲のピーク 5(9月30日 01:00)·過去 24 時間の比較範囲での変化 –

02469月30日01:009月30日09:009月30日16:0010月1日00:00

推移は、途切れずに観測できた同じ主体どうしだけで比べるため、現在の注目度の集計より範囲が狭いことがあります。ポインタを動かすかグラフをクリックすると 1 時間ごとの注目度が見られます。キーボードでは左右の矢印キーで切り替えられます。