【衝撃】Gemini 3.8 FlashとAgentic Videoを解説!動画×AI活用の決定版
概要
Googleの新モデル「Gemini 3.8 Flash」と、動画をリアルタイム解析できる「Gemini 3.7 Agentic Video」を紹介する動画。3.8 Flashはコーディングや資料作成タスクでClaude Opus 5に匹敵する水準まで進化し、Agentic Videoは従来のフレーム単位解析と異なり動画全体を一連の流れとして理解し、トークン消費を60〜80%削減できる点が最大の特徴。
主なポイント
- Gemini 3.8 FlashはWeb版Geminiに加え、Googleのエージェントツール「Antigravity」でも利用可能で、思考時間をLow/Medium/Highから調整できる
- Antigravity+3.8 Flash(High)でPowerPoint資料作成のような実務タスクを、事前に組み込んだデザインシステム通りに再現性高くこなせるようになった
- 料金がClaude Opus 5などと比べて非常に安く、生成速度もGPT5.6の約3倍、Claude Opusの約4倍と圧倒的に速い
- 長尺動画理解のベンチマーク(LVBench)でGemini 3.8が87.8%を記録し、Claude Opus 5(75.4%)やGPT5.6(82%)を上回った
- Agentic Videoは動画を1フレームずつでなく一連のシーケンスとして理解するため、フィラーワード・言い直し・無音部分の検出や自動カットが高精度で行える
- 操作画面を撮影した動画から、クリック箇所に赤枠や矢印を自動挿入したNotionマニュアルを1本の動画だけで生成できる
- ライブ配信でも背景の物体や人の位置をリアルタイムに認識し、指示するだけで矢印や赤枠を正しい場所に重ねて表示できる
- 話している内容を理解して要点テロップやタイトルをリアルタイムで自動生成できる
- 将来的にYouTube本体にもAgentic Videoが組み込まれ、動画の「内容」から検索できるようになる見込み
実践に使えること
- 資料作成やスライド生成はAntigravity+Gemini 3.8 Flash(High)を試し、既存のデザインシステムをスキルとして仕込んでおくと再現性の高いアウトプットが得られる
- 操作手順を録画するだけでキャプチャ抽出・注釈付きマニュアルを自動生成するワークフロー(動画→Notionスキル)を構築すると、マニュアル作成の工数を大幅に削減できる
- 動画編集の下ごしらえ(フィラーワード除去・無音カット・言い直し検出)にGemini系モデルを使うと、トークンコストを抑えつつ高速に処理できる
- ライブ配信やデモ動画で「背景のあれを指してテロップ入れて」のような自然言語指示だけで演出を加えられるツールの構築を検討する余地がある