01
AI TRANSPARENCY · OPENAI
AI音声にも「出どころ表示」が広がる
生成音声の由来確認を表現したオリジナルイラストOpenAIはGPT-Liveの対応音声にSynthIDによる透かしを追加し、生成音声の由来を確認する仕組みを拡張しました。対象はChatGPT VoiceとOpenAI APIを通じて生成された対応音声です。
一般向けの確認ツールに加え、組織や開発者が自分たちの仕組みに確認機能を組み込めるAPIも案内されています。すべての音声を判別するものではなく、対応するOpenAI由来の信号を検出する仕組みとして位置づけられています。
OpenAI公式発表を見る ↗公開:2026年7月8日/更新:7月31日
02
AI MEDIA · RUNWAY
用途に合う生成モデルを自動で選ぶ時代へ
生成メディアの振り分けを表現したオリジナルイラストRunwayは、画像・動画・音声・リアルタイムキャラクターなどの生成モデルを一つの開発基盤から扱えるRunway Devを公開しました。
同時に発表されたMedia Routerは、依頼内容ごとに適した生成モデルを自動で選択する仕組みです。単に一つのモデルへ固定するのではなく、生成結果の好みや用途に合わせて複数モデルを使い分ける方向性を示しています。
Runway公式発表を見る ↗公開:2026年7月23日
03
IMAGE & VIDEO · META
参照画像を使い、シリーズの世界観をそろえる
参照画像による一貫性を表現したオリジナルイラストMetaは画像生成・編集モデルMuse Imageを公開し、同じ事前学習基盤を使うMuse Videoを予告しました。Muse Imageは複数の参照画像を使った構成や、指示に沿った細かな編集に対応すると説明されています。
Muse ImageはMeta AIなどで提供が始まっています。一方、映像と音声を扱うMuse Videoは現時点では先行紹介であり、クリエイターやMeta AIへの提供は今後とされています。
Meta公式発表を見る ↗公開:2026年7月7日
04
AI MODEL · GOOGLE
速度と効率を重視するGeminiモデルが更新
軽量モデルの速度と効率を表現したオリジナルイラストGoogleはGemini 3.6 Flash、3.5 Flash-Lite、3.5 Flash Cyberを発表しました。Flash系は、応答速度と効率を重視しながら、AIエージェントやコーディングなどの処理を支えるモデル群です。
Googleによると、3.6 Flashは3.5 Flashと比べ、評価によっては出力トークン数や推論手順、ツール呼び出しを減らしながら性能を高めたとしています。用途に合わせて品質・速度・費用を選ぶ流れがさらに明確になっています。
Google公式発表を見る ↗公開:2026年7月21日