study mode を導入
答えを直接示さず、手順を追って考えさせる学習モードを追加した。Free、Plus、Pro、Team で利用できる。
この月に主要AIサービスで起きた30件の出来事です。対話AI 6件、開発 4件、統合エージェント 3件、リサーチ 5件、画像生成 5件、動画生成 7件。
答えを直接示さず、手順を追って考えさせる学習モードを追加した。Free、Plus、Pro、Team で利用できる。
低コスト・高速の gemini-2.5-flash-lite が API で正式版になった。
API で Claude 2.0、2.1、Claude 3 Sonnet が使えなくなった。2025年1月に告知されていた。
調べる、操作する、成果物を作るを一つにまとめた ChatGPT agent を公開した。Operator と deep research の流れを統合し、Pro、Plus、Team 向けから展開した。
写真1枚から音声付きの8秒動画を作る機能が Gemini に加わった。Veo 3 を使い、Google AI Pro と Ultra の利用者向けに順次提供された。生成物には目に見える透かしと SynthID が入る。
強化学習を大規模に行った推論モデル。ウェブ検索、コード実行、X 検索を自分で使い分けるネイティブなツール利用を備える。Humanity's Last Exam で50.7%の成績が示された。
Devin が Model Context Protocol に対応した。設定画面の MCP Marketplace から Datadog、Sentry、Figma などのサーバーをつなげる。
JetBrains プラグインの更新履歴に、Planning Mode、カスタムワークフロー、ファイル単位のルール、音声入力の追加が記載されている。
Cognition が IDE の Windsurf を買収する正式合意を発表した。Windsurf は年間経常収益8200万ドル、法人顧客350社超を抱えていた。
Cognition が、エージェント型 IDE の Windsurf を買収する正式契約を結んだと発表した。対象は Windsurf の知的財産、製品、商標、ブランド、事業と従業員。Windsurf のチームはこれまで通り運営を続けると説明している。
数百件規模の調査を、複数のエージェントが並列で処理する機能。専用の仮想マシン上で動かし、当初は Pro ユーザー向けに提供した。
公式ブログで、1つの指示からポッドキャストを作る AI Pods が発表された。
公式ブログで、1つの指示から文書を作成する AI Docs が発表された。
資料の画像、図、数値を使って AI が解説する、ナレーション付きスライド形式の動画を作れる。当初は英語のみ。Studio は同じ種類の出力を1つのノートブックに複数保存できるように改めた。
株価などが目標値に達した時に通知する価格アラートと、決算カレンダー、決算説明会の要約を追加した。Morningstar の分析レポートも無料で読める。
Perplexity の検索を標準に置いた AI ブラウザ。サイドバーのアシスタントがページを読み、メール要約やタブ整理などを代行する。当初は Max 加入者と順番待ちの招待者だけが使えた。
Labs の無制限利用と、新機能の先行利用が付く最上位プラン。OpenAI と Anthropic の新しいモデルへの優先アクセスも含む。既存の Pro は月20ドルのまま残った。
複数のフロンティアモデルを推論時に協調させる探索手法 AB-MCTS を発表した。実装の TreeQuest を Apache 2.0 で GitHub に公開した。
Krea AI と共同開発した、テキストから画像を作る重み公開モデル。AI らしい過度な彩度を抑え、写実的な描写を狙っている。
Explore ページに、好みに合わせた作品を並べる For You フィードを追加した。上位の動画を流し続ける実験ページ Midjourney TV も始めた。
動画をループさせる機能と、開始画像と終了画像を指定する機能を追加した。あわせて Discord ボットでも動画を作れるようになった。
テキストや声で効果音を作る Generate Sound Effects がベータ公開された。動画生成では、構図の参照やスタイルプリセットなどの操作が加わった。Runway の Gen-4 Video と Google の Veo 3 も選べるようになった。
企業のサービスや業務に組み込める Enterprise API を検討しているとして、フォームで希望者を募った。提供の決定ではなく、関心の確認にとどまる。
Gemini API に高速で低価格な Veo 3 Fast が加わり、Veo 3 でも画像から動画の生成が可能になった。Veo 3 Fast のテキストから動画は1秒あたり0.40ドル、画像から動画は両モデルとも0.75ドルだった。
Vertex AI で Veo 3 と Veo 3 Fast が一般提供(GA)になった。
既存の動画に対し、物体の追加や削除、別アングルの生成、スタイルや照明の変更ができる動画モデル。すべての有料ユーザーが使える。
画像から動画への Elements を更新し、被写体の一貫性と動きを改善した。参照画像の中で、被写体・顔・衣装など参照する範囲を選べるようになった。
Veo 3 が Gemini API と Vertex AI で有料プレビューになった。映像と音声の出力は1秒あたり0.75ドル。当初はテキストから動画のみで、画像から動画は後日の予定とされた。
Flow の Frames to Video で、Veo 3 によるセリフの生成ができるようになった。あわせて Flow と Google AI Ultra の提供が76か国増え、140か国以上になった。
Gemini アプリで、写真を指定して動きと音声を文章で指示すると、Veo 3 が音声付き8秒の動画にする機能が加わった。Google AI Pro と Ultra の加入者が対象で、動画には可視の透かしと SynthID が付く。