AI時短ラボ
検索

動画生成AIの記事

「動画生成AI」に関連するAIニュースと解説、33本。新しい順に並べています。

解除

動画生成AI の記事:33件

Gemini「エージェント型の動画理解」──毎秒1フレームで丸ごと読む代わりに、必要な区間だけ探して見直す。トークン最大88%減・費用最大66%減・精度最大7%向上(Google DeepMind、3.7 Flash・3.6 Flash・3.5 Flash-Lite)。APIの設定を"agentic"にするだけ、追加料金なし。Geminiアプリと「Ask YouTube」にも順次の記事画像

Gemini「エージェント型の動画理解」 毎秒1フレームで丸ごと読む代わりに、必要な区間だけ探して見直す。トークン最大88%減・費用最大66%減・精度最大7%向上(Google DeepMind、3.7 Flash・3.6 Flash・3.5 Flash-Lite)。APIの設定を"agentic"にするだけ、追加料金なし。Geminiアプリと「Ask YouTube」にも順次

検証(発表 9月1日)
Agora-2のボス戦の画面に「全部AIが描いてる」の文字を載せた解説動画のサムネイル動画

Odysseyの世界モデル「Agora-2」にOpus 5.5を4回入れてみた 0キルから50キル、ボス撃破まで。ゲームエンジンのどこをAIが引き受け、どこがルールのまま残っているか

モデル
Google公式ブログの発表ページのヘッダー画像。「Video duration」のスライダー、「Extend」ボタン、720p/1080pの解像度選択が描かれている

Google Vids、Gemini Omni 1.1 Flashで誰でも無料の1080p動画生成へ 個人アカウントの無料枠は英語版ヘルプで「月6本」

プロダクト
YouTube「Made On YouTube 2026」発表──Shorts会話型AI編集・Live自動吹き替え・肖像検出の拡大、使える時期はバラバラの記事画像

YouTube「Made On YouTube 2026」発表 Shorts会話型AI編集・Live自動吹き替え・肖像検出の拡大、使える時期はバラバラ

プロダクト
ByteDanceが「見ながら聞きながら話す」全二重AIを実運用投入──音声だけのGPT系リアルタイムAIとの違いはどこにあるかの記事画像

ByteDanceが「見ながら聞きながら話す」全二重AIを実運用投入 音声だけのGPT系リアルタイムAIとの違いはどこにあるか

モデル
Grok Imagineの「エージェントモード」とは──1本の動画を単発プロンプトでなく「プロジェクト」として作るの記事画像

Grok Imagineの「エージェントモード」とは 1本の動画を単発プロンプトでなく「プロジェクト」として作る

プロダクト
Higgsfieldが評価額54億ドルでシリーズB調達──8カ月前の4倍、年換算売上7億ドル・Fortune 500の390社と取引と自社発表の記事画像

Higgsfieldが評価額54億ドルでシリーズB調達 8カ月前の4倍、年換算売上7億ドル・Fortune 500の390社と取引と自社発表

業界
RedNoteのdots3-noteをllama.cppがサポート──280Bのマルチモーダル、動くのは16B、Apache 2.0の記事画像

RedNoteのdots3-noteをllama.cppがサポート 280Bのマルチモーダル、動くのは16B、Apache 2.0

モデル
PixVerse Growth Studioとは──製品URLから広告動画バッチを作る新機能の記事画像

PixVerse Growth Studioとは 製品URLから広告動画バッチを作る新機能

プロダクト
Figma Weaveとは?画像・動画・音声をつなぐ新AIワークフローを確認したの記事画像

Figma Weaveとは?画像・動画・音声をつなぐ新AIワークフローを確認した

検証
LightricksがLTX-2.5をオープンウェイト公開──HDR ACES対応の動画生成モデルとLTX Studioは別物の記事画像

LightricksがLTX-2.5をオープンウェイト公開 HDR ACES対応の動画生成モデルとLTX Studioは別物

モデル
「AI動画の税金」にLumaが挑む──承認するまでレンダリングしない「Luma Scenes」の設計の記事画像

「AI動画の税金」にLumaが挑む 承認するまでレンダリングしない「Luma Scenes」の設計

プロダクト
RunwayがGWM-1で目指す次──「動画生成」から「世界そのものをシミュレートする」への転換の記事画像

RunwayがGWM-1で目指す次 「動画生成」から「世界そのものをシミュレートする」への転換

プロダクト
diffusersの「Modular Diffusers」が実験段階を卒業──新モデルは既に旧来パイプラインを持たずModular専用で配布されるの記事画像

diffusersの「Modular Diffusers」が実験段階を卒業 新モデルは既に旧来パイプラインを持たずModular専用で配布される

検証
画像モデルFLUXが動画に本格参入──「FLUX 3 Video」と4Kアップスケーラーを公式ブログで確認するの記事画像

画像モデルFLUXが動画に本格参入 「FLUX 3 Video」と4Kアップスケーラーを公式ブログで確認する

プロダクト
grok-imagine-video-1.5がネイティブ1080p対応に──text-to-videoは内部で2段階処理という仕組みの記事画像

grok-imagine-video-1.5がネイティブ1080p対応に text-to-videoは内部で2段階処理という仕組み

モデル
「RekaDaily-10k」とは何か──有償の一人称視点動画10,865時間、80TBがApache 2.0で公開中の記事画像

「RekaDaily-10k」とは何か 有償の一人称視点動画10,865時間、80TBがApache 2.0で公開中

研究
派手な発表の裏で静かに公開された中国勢3モデル──文書検索・マルチモーダル埋め込み・動画編集パイプライン【2026年8月】の記事画像

派手な発表の裏で静かに公開された中国勢3モデル 文書検索・マルチモーダル埋め込み・動画編集パイプライン【2026年8月】

モデル
動画のPikaが音声4モデルを一挙公開──「ElevenLabsの9倍安い」という自己申告の中身の記事画像

動画のPikaが音声4モデルを一挙公開 「ElevenLabsの9倍安い」という自己申告の中身

プロダクト
Twitch配信がAI学習に使われる──Amazonをオプトアウト方式めぐり集団訴訟の記事画像

Twitch配信がAI学習に使われる Amazonをオプトアウト方式めぐり集団訴訟

業界
ComfyUIの新アテンション実装「Comfy Kitchen」──int8量子化で計算する専用カーネル群が起動オプション1つで切り替わるの記事画像

ComfyUIの新アテンション実装「Comfy Kitchen」 int8量子化で計算する専用カーネル群が起動オプション1つで切り替わる

検証
MiniMax-H3の動画生成、「先頭と末尾」だけだった制約をComfyUIが外した──任意フレームに画像・音声を固定できるAddGuideノードの記事画像

MiniMax-H3の動画生成、「先頭と末尾」だけだった制約をComfyUIが外した 任意フレームに画像・音声を固定できるAddGuideノード

検証
動画を「会話しながら」直す──Gemini Omni Flashの対話型編集を料金・仕様から読み解くの記事画像

動画を「会話しながら」直す Gemini Omni Flashの対話型編集を料金・仕様から読み解く

プロダクト
Videos APIとSora 2系、9月24日に全スナップショット停止──公式ページで確認、後継モデルの発表はまだ無いの記事画像

Videos APIとSora 2系、9月24日に全スナップショット停止 公式ページで確認、後継モデルの発表はまだ無い

モデル

古い記事は月別アーカイブから ›