OpenAI、ChatGPT Images 2.5を公開
OpenAIはChatGPT Images 2.5を公開した。アイデア、スケッチ、参考写真を、より個性的で洗練された画像に変換でき、ユーザーの考えをよりよく表す画像になるという。
AI による画像制作の最前線:画像生成モデルの更新、画像編集、制作ツールのエコシステム。
OpenAIはChatGPT Images 2.5を公開した。アイデア、スケッチ、参考写真を、より個性的で洗練された画像に変換でき、ユーザーの考えをよりよく表す画像になるという。
Hugging FaceはDiffusersにNunchaku Liteを導入した。from_pretrained()で量子化チェックポイントを直接読み込み、独自パイプラインやローカルのCUDAコンパイルを必要としない。
Google DeepMindはNano Banana 2 Lite(gemini-3.1-flash-lite-image)とGemini Omni Flash(gemini-omni-flash-preview)の2モデルを公開した。
Google ResearchはGoogle PhotosのAuto frameに、撮影後のカメラ視点を変える新手法を導入した。内部の3D点マップ推定モデルで場面と焦点距離を再構成し、生成型潜在拡散モデルで新たな視点から露出する空白領域を埋める。顔の位置と広角の歪みを自動検出して理想的な構図を提案する。人物を含む写真には既に自動適用され、ユーザーはAuto frameの候補から構図を変えた版を選べる。