動画生成AIの記事
「動画生成AI」に関連するAIニュースと解説、33本。新しい順に並べています。
動画生成AI の記事:33件
Gemini「エージェント型の動画理解」 毎秒1フレームで丸ごと読む代わりに、必要な区間だけ探して見直す。トークン最大88%減・費用最大66%減・精度最大7%向上(Google DeepMind、3.7 Flash・3.6 Flash・3.5 Flash-Lite)。APIの設定を"agentic"にするだけ、追加料金なし。Geminiアプリと「Ask YouTube」にも順次
Gemini「エージェント型の動画理解」毎秒1フレームで丸ごと読む代わりに、必要な区間だけ探して見直す。トークン最大88%減・費用最大66%減・精度最大7%向上(Google DeepMind、3.7 Flash・3.6 Flash・3.5 Flash-Lite)。APIの設定を"agentic"にするだけ、追加料金なし。Geminiアプリと「Ask YouTube」にも順次
検証
Odysseyの世界モデル「Agora-2」にOpus 5.5を4回入れてみた 0キルから50キル、ボス撃破まで。ゲームエンジンのどこをAIが引き受け、どこがルールのまま残っているか
Odysseyの世界モデル「Agora-2」にOpus 5.5を4回入れてみた0キルから50キル、ボス撃破まで。ゲームエンジンのどこをAIが引き受け、どこがルールのまま残っているか
モデル
Google Vids、Gemini Omni 1.1 Flashで誰でも無料の1080p動画生成へ 個人アカウントの無料枠は英語版ヘルプで「月6本」
Google Vids、Gemini Omni 1.1 Flashで誰でも無料の1080p動画生成へ個人アカウントの無料枠は英語版ヘルプで「月6本」
プロダクト
YouTube「Made On YouTube 2026」発表 Shorts会話型AI編集・Live自動吹き替え・肖像検出の拡大、使える時期はバラバラ
YouTube「Made On YouTube 2026」発表Shorts会話型AI編集・Live自動吹き替え・肖像検出の拡大、使える時期はバラバラ
プロダクト
ByteDanceが「見ながら聞きながら話す」全二重AIを実運用投入 音声だけのGPT系リアルタイムAIとの違いはどこにあるか
ByteDanceが「見ながら聞きながら話す」全二重AIを実運用投入音声だけのGPT系リアルタイムAIとの違いはどこにあるか
モデル
Grok Imagineの「エージェントモード」とは 1本の動画を単発プロンプトでなく「プロジェクト」として作る
Grok Imagineの「エージェントモード」とは1本の動画を単発プロンプトでなく「プロジェクト」として作る
プロダクト
Higgsfieldが評価額54億ドルでシリーズB調達 8カ月前の4倍、年換算売上7億ドル・Fortune 500の390社と取引と自社発表
Higgsfieldが評価額54億ドルでシリーズB調達8カ月前の4倍、年換算売上7億ドル・Fortune 500の390社と取引と自社発表
業界
RedNoteのdots3-noteをllama.cppがサポート 280Bのマルチモーダル、動くのは16B、Apache 2.0
RedNoteのdots3-noteをllama.cppがサポート280Bのマルチモーダル、動くのは16B、Apache 2.0
モデル
PixVerse Growth Studioとは 製品URLから広告動画バッチを作る新機能
PixVerse Growth Studioとは製品URLから広告動画バッチを作る新機能
プロダクト
Figma Weaveとは?画像・動画・音声をつなぐ新AIワークフローを確認した
Figma Weaveとは?画像・動画・音声をつなぐ新AIワークフローを確認した
検証
LightricksがLTX-2.5をオープンウェイト公開 HDR ACES対応の動画生成モデルとLTX Studioは別物
LightricksがLTX-2.5をオープンウェイト公開HDR ACES対応の動画生成モデルとLTX Studioは別物
モデル
「AI動画の税金」にLumaが挑む 承認するまでレンダリングしない「Luma Scenes」の設計
「AI動画の税金」にLumaが挑む承認するまでレンダリングしない「Luma Scenes」の設計
プロダクト
RunwayがGWM-1で目指す次 「動画生成」から「世界そのものをシミュレートする」への転換
RunwayがGWM-1で目指す次「動画生成」から「世界そのものをシミュレートする」への転換
プロダクト
diffusersの「Modular Diffusers」が実験段階を卒業 新モデルは既に旧来パイプラインを持たずModular専用で配布される
diffusersの「Modular Diffusers」が実験段階を卒業新モデルは既に旧来パイプラインを持たずModular専用で配布される
検証
画像モデルFLUXが動画に本格参入 「FLUX 3 Video」と4Kアップスケーラーを公式ブログで確認する
画像モデルFLUXが動画に本格参入「FLUX 3 Video」と4Kアップスケーラーを公式ブログで確認する
プロダクト
grok-imagine-video-1.5がネイティブ1080p対応に text-to-videoは内部で2段階処理という仕組み
grok-imagine-video-1.5がネイティブ1080p対応にtext-to-videoは内部で2段階処理という仕組み
モデル
「RekaDaily-10k」とは何か 有償の一人称視点動画10,865時間、80TBがApache 2.0で公開中
「RekaDaily-10k」とは何か有償の一人称視点動画10,865時間、80TBがApache 2.0で公開中
研究
派手な発表の裏で静かに公開された中国勢3モデル 文書検索・マルチモーダル埋め込み・動画編集パイプライン【2026年8月】
派手な発表の裏で静かに公開された中国勢3モデル文書検索・マルチモーダル埋め込み・動画編集パイプライン【2026年8月】
モデル
動画のPikaが音声4モデルを一挙公開 「ElevenLabsの9倍安い」という自己申告の中身
動画のPikaが音声4モデルを一挙公開「ElevenLabsの9倍安い」という自己申告の中身
プロダクト
Twitch配信がAI学習に使われる Amazonをオプトアウト方式めぐり集団訴訟
Twitch配信がAI学習に使われるAmazonをオプトアウト方式めぐり集団訴訟
業界
ComfyUIの新アテンション実装「Comfy Kitchen」 int8量子化で計算する専用カーネル群が起動オプション1つで切り替わる
ComfyUIの新アテンション実装「Comfy Kitchen」int8量子化で計算する専用カーネル群が起動オプション1つで切り替わる
検証
MiniMax-H3の動画生成、「先頭と末尾」だけだった制約をComfyUIが外した 任意フレームに画像・音声を固定できるAddGuideノード
MiniMax-H3の動画生成、「先頭と末尾」だけだった制約をComfyUIが外した任意フレームに画像・音声を固定できるAddGuideノード
検証
動画を「会話しながら」直す Gemini Omni Flashの対話型編集を料金・仕様から読み解く
動画を「会話しながら」直すGemini Omni Flashの対話型編集を料金・仕様から読み解く
プロダクト
Videos APIとSora 2系、9月24日に全スナップショット停止 公式ページで確認、後継モデルの発表はまだ無い
Videos APIとSora 2系、9月24日に全スナップショット停止公式ページで確認、後継モデルの発表はまだ無い
モデル