Google

Google Veo

Google Veo 3.1は、ネイティブな音声合成、写真と見紛うほどの高画質、そして最高1080pの解像度を備えた、業界最高水準の動画生成を実現します。Extendバリアントには、既存クリップをシームレスに延伸する動画継続機能とV2V(動画から動画)機能が追加されています。

Veo 3.1はGoogleのフラッグシップ動画モデルで、テキストから動画生成と画像から動画生成に、別工程で後付けするのではなく映像と同時にネイティブ生成される内蔵音声を組み合わせています。FastとStandardの2つの生成グレードを提供し、スタイルとキャラクターの誘導のために参照画像に対応しており、720pまたは1080pで出力します。Extendバリアントは既存の動画クリップを受け取り、V2Vモードでシームレスに続きを生成します。この2つを組み合わせることで、最初の生成から延伸まで、同期音声つきのエンドツーエンドな動画制作が可能になります。

Illustrative sample of a Google Veo 3.1 photorealistic cinematic still implying natively generated synchronized audio on the Astorie canvas
Illustrative sample — representative output, not a verbatim model render

Google Veo Variants

VariantDescription
Veo 3.1ネイティブ音声と参照画像対応を備えたテキストから動画生成・画像から動画生成。FastとStandardのグレードがあり、最高1080p。
Veo 3.1 Extend既存クリップのシームレスな延伸と、V2Vによる継続生成です。

Capabilities

Text-to-Video
Image-to-Video
Video-to-Video
Reference Images
End Frame
Storyboard
Audio-Driven

Supported Aspect Ratios

1:116:99:16

Quality Tiers

Standard
Fast

Higher quality tiers generally offer better detail and consistency, but require more credits and generation time.

Best For

  • 同期音声が必要なプロフェッショナルな動画制作
  • 広告・メディア向けの写真品質のコンテンツ
  • クリップ延伸による長尺動画の組み立て
  • ブランドの一貫性を保つ参照画像誘導生成
  • 1080pの高解像度な最終納品物

Strengths

  • ネイティブ音声生成により、個別のフォーリーや音楽制作が不要
  • 現時点で最高水準にある写真品質の出力
  • Fast/Standardの2グレードで速度と品質のバランスを両立
  • 参照画像により、スタイルとキャラクターの見た目を一貫して誘導
  • Extendバリアントにより、複数クリップのシームレスな組み立てが可能

Limitations

  • 高品質な出力の分、軽量モデルよりレンダリング時間が長い
  • Extendバリアントの利用には、起点となる既存クリップが必要
  • ネイティブ音声は、生成後に個別に微調整することができない

Tips & Best Practices

コストを抑えるには、コンセプトの試行にはFastグレード、最終レンダリングにはStandardグレードを使いましょう。
プロンプトに環境音の描写を含めることで、Veoのネイティブ音声生成を誘導しましょう。
求める視覚スタイルそのものの参照画像を与えると、プロンプトの修正回数を減らせます。
ベースモデルとExtendを連結すれば、音声の一貫性を保ちながらより長いシーケンスを構築できます。

Use Google Veo on Astorie

Connect Google Veo with other AI models on Astorie's infinite canvas. No GPU required — start free.

Get Started Free

Related Features

How-To Guides

Related Reading

Related Video Models

Back to All Video Models