グーグルは7月16日、動画編集ツール「Google Vids」に2つの新機能を追加したと発表した。テキストと参照画像から動画を生成・編集する「Gemini Omni」と、自分の姿を模したデジタルアバターでビデオメッセージ...
Google DeepMindは2026年6月30日、2つの新モデルをGoogle AI StudioおよびGemini APIで公開した。画像生成に特化した「Nano Banana 2 Lite(gemini-3.1-...
Google DeepMindは2026年5月17日(Google I/O 2026にて)、マルチモーダル動画生成・編集AIモデル「Gemini Omni」を発表した。テキスト・画像・音声・動画を組み合わせたマルチモーダ...
OpenAIは2026年4月21日、画像生成機能の新バージョン「ChatGPT Images 2.0」を発表した。前世代との最大の違いは「考えてから描く」推論プロセスの導入で、複雑な指示の解釈精度と画像の一貫性が大幅に向...
Google DeepMindは2026年2月26日、画像生成モデルの新バージョン「Nano Banana 2」を発表した。前世代のNano Banana Proが持つ高品質な生成能力と、Gemini Flashシリーズ...
Google DeepMindは2026年2月18日、Geminiアプリにおいて音楽生成機能を提供開始したと発表した。音楽生成モデル「Lyria 3」を基盤にしており、テキストプロンプトや写真・動画を入力するだけで30秒...
Google DeepMindは2026年1月13日、動画生成AIの新バージョン「Veo 3.1」を発表した。前世代からのキャラクター一貫性の向上、縦型動画(9:16)への対応、1080pおよび4K解像度でのアウトプット...
Google DeepMindは2025年11月20日、Gemini 3 Proを基盤とする新しい画像生成・編集モデル「Nano Banana Pro」を発表した。高解像度の画像生成から複数画像を用いた一貫したビジュアル...
OpenAIは2025年4月23日、ChatGPTの画像生成機能と同等のモデル「gpt-image-1」をAPIとして公開した。これにより、開発者が自分のアプリケーションにChatGPT水準の画像生成機能を組み込めるよう...
OpenAIは2025年4月16日、推論モデルo3とo4-miniに対して、思考プロセスの中で画像を直接使って推論できる「Thinking with images」機能を実装したと発表した。 これまでのビジョン対応モデル...

