Google DeepMind、ビデオジェネレータを汎用ビジョンAIに—GenCeptionが深さ推定・セグメンテーションで SOTA達成
Google Deepmind の新研究 GenCeption は、ビデオ生成モデルを汎用コンピュータビジョンタスクに転用。従来比7~500倍少ないデータで実現し、『ビデオジェネレータが世界モデルを含む』という仮説を強化
続きを読むGoogle Deepmind の新研究 GenCeption は、ビデオ生成モデルを汎用コンピュータビジョンタスクに転用。従来比7~500倍少ないデータで実現し、『ビデオジェネレータが世界モデルを含む』という仮説を強化
続きを読むMicrosoft Research が新しいビデオ生成モデル「Mirage」を開発。潜在空間メモリを活用して処理速度を10倍以上、メモリ使用量を55倍削減し、長いカメラ移動でも空間的一貫性を維持する。
続きを読む1枚の写真を入力するだけで、リアルタイムに45分間の音声同期動画を生成するAIモデル「LPM 1.0」が開発された。表情や頷きなどの自然な動きも含まれるが、現在は研究段階で公開予定はなく、深刻な安全懸念も指摘。
続きを読むGoogleはUltraサブスクライバー向けに新しい軽量ビデオ生成モデル「Veo 3.1 Lite」を無料で提供開始。5月10日以降、既存の「Veo 3.1 Fast」の無料版に置き換えられます。
続きを読む