2024年6月

この月に主要AIサービスで起きた14件の出来事です。対話AI 5件、統合エージェント 1件、リサーチ 2件、画像生成 1件、動画生成 2件、音声・会議 2件、業務効率化 1件。

対話AI5

  • Geminiモデル

    1.5 Pro の200万トークンが GA

    API で Gemini 1.5 Pro の200万トークン文脈が一般提供になり、同時にコード実行機能も加わった。

  • Claude機能

    Projects を追加

    資料やスタイルガイドをまとめてアップロードし、その文脈で Claude に作業させる機能。Pro と Team 向けで、チームでの共有もできる。

  • Claude機能

    Artifacts を追加

    生成したコードや文書を、会話の横の専用画面に表示して編集できる機能。Claude 3.5 Sonnet の発表と同時に案内された。

  • Claudeモデル

    Claude 3.5 Sonnet を公開

    Claude 3.5 世代の最初のモデルで、同社で最も高性能な中位モデルとして出た。Artifacts も同時に案内された。

  • DeepSeekモデル

    DeepSeek-Coder-V2-0614 に更新

    API の deepseek-coder を DeepSeek-Coder-V2-0614 に更新した。コード生成の能力が大きく上がったと変更履歴に記されている。

統合エージェント1

  • Genspark機能

    Genspark を紹介する記事を公開

    公式ブログに、Genspark を AI Agentic Engine として紹介する記事が掲載された。公式ブログで日付を確認できる最も古い記事で、サービス開始時期の目安になる。

リサーチ2

  • Perplexity企業

    SoftBank と提携し日本で Pro を提供

    SoftBank、Y!mobile、LINEMO の利用者向けに、Perplexity Pro を1年間無料で試せる提供を6月19日に始めると発表した。SoftBank は出資していない。

  • NotebookLM機能

    NotebookLM が日本語に対応

    200を超える国と地域に提供を広げ、日本語でも使えるようになった。モデルを Gemini 1.5 Pro に更新し、Google スライドとウェブ URL をソースに加えた。回答の引用から原文の該当箇所へ移れる。

画像生成1

  • Midjourney機能

    パーソナライズ機能の試験版を公開

    画像の比較投票や「いいね」から利用者の好みを学び、プロンプトで指定していない部分の仕上がりに反映する機能。約200回の評価で使え、--p で有効にする。

動画生成2

  • Runwayモデル

    Gen-3 Alpha を発表

    Gen-2 より忠実度、一貫性、動きを高めた動画生成モデル。細かく付けたキャプションで学習し、時間方向の細かい制御ができる。テキストから動画、画像から動画、カメラ制御のツールを支える。

  • Klingモデル

    Kling AI を公開

    Kuaishou が動画生成モデルの Kling AI を2024年6月に公開した。2025年6月の公式発表では、公開から1年で20回以上の改良を重ねたとしている。

音声・会議2

  • Suno機能

    Audio Inputs を無料版に開放

    音声の取り込みと続きの生成を、無料アカウントを含む全ユーザーが使えるようにした。取り込めるのは6〜60秒の音声や動画。

  • Suno機能

    Audio Inputs を追加

    自分で録音または取り込んだ6〜60秒の音声から曲を作れる機能。当初は Pro と Premier の会員向けで、著作物の音声は取り込みをブロックする。

業務効率化1

  • Notion AI機能

    Notion AI に Slack 連携と GPT-4

    Slack、Google Drive、Salesforce、Jira などの情報を Notion 内から検索し、出典付きで回答する機能を加えた。チャット履歴の再利用や、メンションで検索範囲を絞る操作にも対応した。