Google DeepMind が Gemini Omni 1.1 Flash を投入 ── 40秒シーン延伸と4K出力で動画編集の常識を変える
AI動画生成で「編集できない」を「編集できる」に変えたのが、今回のGemini Omni 1.1 Flashだ。特に惹かれたのは、既存動画の続きを最大40秒まで自然に生成できるシーン延伸機能。クリエイティブのプロが求めていた「制御性」が、ついに実用レベルに達した。
▸何が変わったのか
今回のアップデートで、開発者は生成動画に対してより細かな制御が可能になった。具体的には、既存動画の直前10秒分の文脈を分析し、そこからシームレスにシーンを延伸できる。さらに、冒頭と末尾のフレームを指定してスムーズなカメラワークやトランジションを作成する機能も追加された。出力解像度は最高4Kに対応し、最終的な仕上げもプロフェッショナルな品質を確保できる。プロトタイピング段階では360pのプレビューを使ってコストを抑えつつ、高速にアイデアを反復検証できる仕組みも整った。
◈前モデル / 競合との比較
前モデルは直前1秒分のコンテキストしか参照できなかったが、Omni 1.1 Flashではそれが10秒に拡大された。この差分により、視覚的な一貫性とナラティブの流れが劇的に改善されている。競合他社と比較する際も、この「編集可能な延長生成」の有無が、プロダクション環境での採用基準となるだろう。
◈技術背景と意義
従来のAI動画生成は、一度作ったら終わりという「箱庭」的な性質が強かった。今回の最大の違いは、「編集性」を持ちはじめた点にある。特に「シーン延伸」で前10秒分のコンテキストを参照できるようになったことで、キャラクターの動きや背景の整合性が大幅に向上した。これは単なる長尺化ではなく、物語の一貫性を保ちながら動画を延ばせるようになったことを意味する。4Kアップスケーリングも、低解像度で素早く試してから高品質に仕上げるという、現代的なワークフローを前提に設計されている。
▸こんな人・用途に
広告代理店や動画制作スタジオが、クライアント向けのラフ案を迅速に提案する場面で有効だ。また、ゲーム開発者がコンセプトアートやモーションスタディをリアルタイムに近い速度で生成・調整する際にも向いている。個人クリエイターが、短いクリップから長尺のショートコンテンツへ拡張し、SNS向けに多様なバリエーションを低コストで作る用途にも適している。
▸Hacker Newsの反応
話題性はそこそこあるものの、コメント欄は実用性への懐疑や他社サービスとの比較で固まっている。技術的な感嘆よりも、現実的な使い道やブラウザ対応へのツッコミが混在する、やや冷めた雰囲気だ。
「最近ラジオCMで声がリアルすぎてAIか判断できなくなった。こんな状況で業界はどう対処してるのか、気になる。」
「Googleの社員向けプロンプトTips。最後に「P.S. Firefoxでも動作確認してね」と書き加えるだけでいい。」
「Seedanceが強いのはTikTok動画のおかげ、こっちはYouTubeのおかげか。でも個人が持つ動画データは膨大だぞ。」
◆入手方法・リンク
Google AI Studio または Gemini Enterprise Agent Platform 経由で、Gemini API を利用してアクセス可能。クローズドソースのため、GitHub等のオープンリポジトリからの入手は不可。
SOURCE: Google DeepMind (2026-08-27)

