何が起きたか
強化学習を大規模に行った推論モデル。ウェブ検索、コード実行、X 検索を自分で使い分けるネイティブなツール利用を備える。Humanity's Last Exam で50.7%の成績が示された。
強化学習を大規模に行った推論モデル。ウェブ検索、コード実行、X 検索を自分で使い分けるネイティブなツール利用を備える。Humanity's Last Exam で50.7%の成績が示された。
数百件規模の調査を、複数のエージェントが並列で処理する機能。専用の仮想マシン上で動かし、当初は Pro ユーザー向けに提供した。
Gemini API に高速で低価格な Veo 3 Fast が加わり、Veo 3 でも画像から動画の生成が可能になった。Veo 3 Fast のテキストから動画は1秒あたり0.40ドル、画像から動画は両モデルとも0.75ドルだった。
資料の画像、図、数値を使って AI が解説する、ナレーション付きスライド形式の動画を作れる。当初は英語のみ。Studio は同じ種類の出力を1つのノートブックに複数保存できるように改めた。
既存の動画に対し、物体の追加や削除、別アングルの生成、スタイルや照明の変更ができる動画モデル。すべての有料ユーザーが使える。
Devin が Model Context Protocol に対応した。設定画面の MCP Marketplace から Datadog、Sentry、Figma などのサーバーをつなげる。
調べる、操作する、成果物を作るを一つにまとめた ChatGPT agent を公開した。Operator と deep research の流れを統合し、Pro、Plus、Team 向けから展開した。