本文へ移動

#モデル発表

今日 4 件

10月1日

木曜日今日4 件
  1. Google、Gemini 4 Argonを発表 OpenAIとAnthropicとの差を縮めるも明確なリードはならず

    Googleは新たなフロンティアモデルGemini 4 Argonを発表した。一部のベンチマークではOpenAIやAnthropicの競合製品を上回るが、明確なリードは得ていない。このモデルはまずFairwindプログラムの「信頼できるサイバー防御者」とGoogle社内チームに公開され、その後開発者、企業、消費者向けに提供される予定で、日付は未公表。導入価格は入力トークン100万あたり2ドル、出力トークン100万あたり10ドルで、キャッシュ入力は95%安い。

  2. Google、Gemini 4 Argon を発表 これまでで最強のモデルと主張

    Google の親会社 Alphabet は Gemini 4 Argon を発表し、コーディングや調査、執筆などのタスクを処理できると説明した。特に防御的サイバーセキュリティ向けに訓練されており、重要なソフトウェア脆弱性を自律的に発見・検証・修正できるという。

  3. Google DeepMind、フロンティアモデル「Gemini 4 Argon」を発表

    Google DeepMindは新たなフロンティアモデル「Gemini 4 Argon」を発表した。まずFairwind Programの信頼できるサイバー防御担当者に開放し、その後開発者、企業、消費者向けに提供する。価格は入力100万トークンあたり2ドル、出力100万トークンあたり10ドルから。

9月30日

水曜日

9月29日

火曜日
  1. NVIDIA、表形式予測の基盤モデルKumo Tabularを公開

    NVIDIAはオープンソースの表形式基盤モデルKumo Tabularを公開した。ラベル付きの表の行を入力すると、学習、調整、特徴量設計なしに、単一の順伝播で新しい行のラベルを予測し、分類と回帰に対応する。28M〜215Mの3サイズを提供し、人工合成の表のみで事前学習した。商用利用可能なOpenMDW-1.1ライセンスを採用し、TabArena、BeyondArena、TALENT、ScoringBenchの4ベンチマークで首位だった。

  2. ElevenLabs、音声モデル Eleven v4 とリアルタイム音声エージェント向け Turbo 版を公開

    ElevenLabs は Eleven v4 を公開した。脚本中の感情、間、効果音タグにより正確に従い、長い制作物でも声質を一貫させる。新アーキテクチャは Turbo 版にも使われ、公式テストでは約150ミリ秒で音声出力を開始した。Cartesia Sonic 3.6 の262ミリ秒、OpenAI GPT-4o mini TTS の814ミリ秒と比較されている。

9月28日

月曜日

9月25日

金曜日

9月24日

木曜日

9月23日

水曜日

9月22日

火曜日
  1. TypeSafe AI、System One の意思決定モデル Jev を公開

    TypeSafe AI は先週 Jev を公開し、新しい「System One モデル」の最初の例としたが、筆者は「意思決定モデル」の呼び名を好む。文字を入力し、分類、はい・いいえ、点数に対応する浮動小数と信頼度を返す。入力だけに課金し、初モデルは100万トークン当たり0.042ドル。筆者は迷惑メール検出、タグ付け、順位付けに適すると考え、検索の再ランキングにも試した一方、数字、日付、敵対的内容は苦手と指摘する。

9月16日

水曜日

9月10日

木曜日

9月9日

水曜日

9月3日

木曜日

9月1日

火曜日

8月28日

金曜日

8月27日

木曜日

8月25日

火曜日

8月14日

金曜日

8月12日

水曜日

8月10日

月曜日

8月6日

木曜日

8月4日

火曜日
  1. Mistral AI、3Bのオープンなマルチモーダル安全分類器Shieldstralを公開

    Mistral AIは30億パラメーターのオープンウェイト安全分類器ShieldstralをApache 2.0で公開した。16GBのNVIDIA GPU1枚で動く。コンテンツ審査を方針に適応する質問回答として扱い、推論時に方針を自然言語で記述すれば、再学習なしで校正済みの安全スコアを返す。文字と画像を共通に処理する。公式説明では、文字の安全性で最大7倍の規模のモデルに匹敵し、マルチモーダル審査のベンチマークで新たな最高成績を達成した。

7月30日

木曜日
  1. Google DeepMind、Flow MusicでLyria 3.5音楽生成モデルを公開

    Google DeepMindは新世代の音楽生成モデルLyria 3.5を公開し、Google Flow Musicで提供を開始した。音楽性、歌詞、歌声、創作の制御の4分野を改善したという。より複雑で自然な旋律構造、指示への追従と構造理解を改善した歌詞、感情表現と発音を改善した歌声、出力のリズムと長さの操作性向上を含む。