2025年7月

この月に主要AIサービスで起きた30件の出来事です。対話AI 6件、開発 4件、統合エージェント 3件、リサーチ 5件、画像生成 5件、動画生成 7件。

対話AI6

  • ChatGPT機能

    study mode を導入

    答えを直接示さず、手順を追って考えさせる学習モードを追加した。Free、Plus、Pro、Team で利用できる。

  • ChatGPT機能

    ChatGPT agent を提供開始

    調べる、操作する、成果物を作るを一つにまとめた ChatGPT agent を公開した。Operator と deep research の流れを統合し、Pro、Plus、Team 向けから展開した。

  • Gemini機能

    写真から動画を作る機能

    写真1枚から音声付きの8秒動画を作る機能が Gemini に加わった。Veo 3 を使い、Google AI Pro と Ultra の利用者向けに順次提供された。生成物には目に見える透かしと SynthID が入る。

  • Grokモデル

    Grok 4 を公開

    強化学習を大規模に行った推論モデル。ウェブ検索、コード実行、X 検索を自分で使い分けるネイティブなツール利用を備える。Humanity's Last Exam で50.7%の成績が示された。

開発4

  • Devin機能

    MCP Marketplace を開始

    Devin が Model Context Protocol に対応した。設定画面の MCP Marketplace から Datadog、Sentry、Figma などのサーバーをつなげる。

  • Windsurf機能

    プラグインに Planning Mode を追加

    JetBrains プラグインの更新履歴に、Planning Mode、カスタムワークフロー、ファイル単位のルール、音声入力の追加が記載されている。

  • Devin企業

    Windsurf の買収で合意

    Cognition が IDE の Windsurf を買収する正式合意を発表した。Windsurf は年間経常収益8200万ドル、法人顧客350社超を抱えていた。

  • Windsurf企業

    Cognition が Windsurf 買収で合意

    Cognition が、エージェント型 IDE の Windsurf を買収する正式契約を結んだと発表した。対象は Windsurf の知的財産、製品、商標、ブランド、事業と従業員。Windsurf のチームはこれまで通り運営を続けると説明している。

統合エージェント3

  • Manus機能

    Wide Research を公開

    数百件規模の調査を、複数のエージェントが並列で処理する機能。専用の仮想マシン上で動かし、当初は Pro ユーザー向けに提供した。

  • Genspark機能

    AI Pods を公開

    公式ブログで、1つの指示からポッドキャストを作る AI Pods が発表された。

  • Genspark機能

    AI Docs を公開

    公式ブログで、1つの指示から文書を作成する AI Docs が発表された。

リサーチ5

  • NotebookLM機能

    Video Overviews(ビデオ解説)を追加

    資料の画像、図、数値を使って AI が解説する、ナレーション付きスライド形式の動画を作れる。当初は英語のみ。Studio は同じ種類の出力を1つのノートブックに複数保存できるように改めた。

  • Perplexity機能

    Finance に決算タブと価格アラートを追加

    株価などが目標値に達した時に通知する価格アラートと、決算カレンダー、決算説明会の要約を追加した。Morningstar の分析レポートも無料で読める。

  • Perplexity機能

    AI ブラウザ Comet を公開

    Perplexity の検索を標準に置いた AI ブラウザ。サイドバーのアシスタントがページを読み、メール要約やタブ整理などを代行する。当初は Max 加入者と順番待ちの招待者だけが使えた。

  • Perplexity料金

    月額200ドルの Max プランを開始

    Labs の無制限利用と、新機能の先行利用が付く最上位プラン。OpenAI と Anthropic の新しいモデルへの優先アクセスも含む。既存の Pro は月20ドルのまま残った。

  • Sakana AIモデル

    AB-MCTS と TreeQuest を公開

    複数のフロンティアモデルを推論時に協調させる探索手法 AB-MCTS を発表した。実装の TreeQuest を Apache 2.0 で GitHub に公開した。

画像生成5

  • FLUXモデル

    FLUX.1 Krea [dev] を公開

    Krea AI と共同開発した、テキストから画像を作る重み公開モデル。AI らしい過度な彩度を抑え、写実的な描写を狙っている。

  • Midjourney機能

    動画のループと終了フレーム指定

    動画をループさせる機能と、開始画像と終了画像を指定する機能を追加した。あわせて Discord ボットでも動画を作れるようになった。

  • Adobe Firefly機能

    効果音生成と Veo 3 などを追加

    テキストや声で効果音を作る Generate Sound Effects がベータ公開された。動画生成では、構図の参照やスタイルプリセットなどの操作が加わった。Runway の Gen-4 Video と Google の Veo 3 も選べるようになった。

  • Midjourney企業

    Enterprise API の関心調査を開始

    企業のサービスや業務に組み込める Enterprise API を検討しているとして、フォームで希望者を募った。提供の決定ではなく、関心の確認にとどまる。

動画生成7

  • Veoモデル

    Veo 3 Fast と画像から動画を提供

    Gemini API に高速で低価格な Veo 3 Fast が加わり、Veo 3 でも画像から動画の生成が可能になった。Veo 3 Fast のテキストから動画は1秒あたり0.40ドル、画像から動画は両モデルとも0.75ドルだった。

  • Runwayモデル

    Aleph を公開

    既存の動画に対し、物体の追加や削除、別アングルの生成、スタイルや照明の変更ができる動画モデル。すべての有料ユーザーが使える。

  • Kling機能

    Elements を改良

    画像から動画への Elements を更新し、被写体の一貫性と動きを改善した。参照画像の中で、被写体・顔・衣装など参照する範囲を選べるようになった。

  • Veoモデル

    Veo 3 を Gemini API で提供

    Veo 3 が Gemini API と Vertex AI で有料プレビューになった。映像と音声の出力は1秒あたり0.75ドル。当初はテキストから動画のみで、画像から動画は後日の予定とされた。

  • Veo機能

    Flow が音声付き動画と140か国超に対応

    Flow の Frames to Video で、Veo 3 によるセリフの生成ができるようになった。あわせて Flow と Google AI Ultra の提供が76か国増え、140か国以上になった。

  • Veo機能

    Gemini で写真から動画を生成

    Gemini アプリで、写真を指定して動きと音声を文章で指示すると、Veo 3 が音声付き8秒の動画にする機能が加わった。Google AI Pro と Ultra の加入者が対象で、動画には可視の透かしと SynthID が付く。