3 Models Available
どんな写真やイラストにも命を吹き込みます。画像をアップロードするだけで、AIが自然な動き、カメラワーク、映画のようなエフェクトを生成します。

AIで静止画を動かすには、写真を画像から動画へのモデルにアップロードし、欲しい動きだけを(シーンではなく)説明する短いプロンプトを書いて、短いクリップを生成します——AIはあなたの1枚のフレームから、自然な動き、カメラワーク、光の変化を作り出します。Astorieでは、GPUもインストールも不要なブラウザベースのキャンバス上でこれを行えます:画像を画像ノードに入れ、1つ以上の動画ノードに接続し、複数の最先端動画モデルに同時にかけるだけです。
2026年現在、静止写真から動くクリップへの最も速い道は画像から動画への変換(しばしばimg2vidと略されます)です。言葉だけからクリップを生成するテキストから動画への変換とは異なり、画像から動画への変換はあなたの写真そのものから始まるため、被写体、色、構図は固定されたまま、AIがその上に動きを加えます。だからこそ「この写真を動かしたい」というニーズに最適なツールになるのです:あなたの商品、キャラクター、作品は再構築されるのではなく、フレームからフレームへとそのまま保たれます。
手順はどのモデルでも同じ5ステップです:(1) 動きを暗示する元画像を選ぶ(歩いている途中の人物、風になびく髪、今まさに砕けようとする波は、硬直した左右対称の証明写真よりもはるかによく動きます)。(2) 被写体に適した動画モデルを選ぶ(下記のモデル選択を参照)。(3) 動詞とカメラ方向だけを使った運動専用のプロンプトを書く——フレームに既に写っているものを再度説明してはいけません。(4) 長さとアスペクト比を設定する(ほとんどのモデルは16:9または9:16で5秒のクリップをレンダリングします)。(5) 生成し、バージョントレイで各テイクを確認して、気に入ったものを書き出します——NLEタイムラインへの直接書き出しも含めて。

画質を左右する最大の決断は、どのモデルで画像を動かすかです。このページの3つの画像から動画へのモデルにはそれぞれ明確な得意分野があり、Astorieでは1枚の元画像を一度にすべてのモデルへ展開できるため、事前に推測するのではなく、同じ写真を全モデルに並行してかけて最良のテイクを残すことができます。
フレームに人の顔がある場合はKling 3.0を選びましょう。そのProティアは、このページのどのモデルよりも自然な表情の機微、瞬きのリズム、唇の動きを生み出します——「明らかにAI」と「え、これ本物?」の違いを生む部分です。顔が関係ない風景や物体にはStandardティアを使いましょう。体感品質は同じで、レンダリングはより高速です。
高エネルギーなアクション、ドラマチックな動き、イラストやアニメ調の静止画にはSeedance 2.0(ByteDance)を選びましょう。キャラクターが飛び出す、布が激しく揺れる、様式化されたシーンが動き出すといった、Klingが得意とする繊細で自然な抑制感ではなく、勢いのある動きが欲しいときの専門家です。
カメラそのものが主役のときはLuma Ray 2を選びましょう。Ray 2は最も映画的なカメラの物理表現を実現します——ゆっくりとしたドリー、穏やかな旋回、そして平坦な風景写真に本物の奥行きを与える自然な視差を、フィルムグレインで仕上げます。静止シーンから動くエスタブリッシングショットを作りたいなら、ここから始めましょう。
実用的なワークフローとしては、まずKling 3.0 Standardで下書きして運動の方向性を素早くテストし、人物が被写体の場合はKling 3.0 Proで仕上げ、カメラの動きが必要な風景にはRay 2に切り替え、ショットに大胆なアクションが求められるときはSeedance 2.0を使います。このページのどのモデルも5秒のクリップをレンダリングするので、より長いシーケンスは複数のショットとして計画し、タイムライン上で組み立てましょう。

静止画を動かす際に最もよくある、そして最もコストの高い間違いは、すでに見えているものを再度説明してしまうことです。モデルはあなたの写真のすべてのピクセルをすでに見ています。プロンプトは100%運動の指示であるべきで、シーンの説明は0%にすべきです。「彼女はまばたきをし、頭を左に傾け、温かい笑みを浮かべる。髪は軽い風に揺れる。カメラは静止」と書くべきで、「陽の当たる庭で青いドレスを着た茶色い髪の女性」と書いてはいけません。シーンを再説明すると、モデルはあなたの言葉と画像を無理に一致させようとし、色味のズレや望まない細部の変化を引き起こします。
「カメラは静止」であっても、必ず明示的なカメラ指示を含めてください。指示がないと、モデルが被写体の動きと競合する独自のカメラワークを勝手に加えることがあります。「ゆっくり前へ寄る」は親密さを生み、「穏やかに旋回する」は奥行きを見せ、「後ろに引く」は劇的な見せ方になります——風景の場合、単純な前進だけでも前景と背景の間に本物の3D視差が生まれます。
動きの強さは元画像が暗示するものに合わせましょう。フォーマルで静止した肖像写真に急に走らせたり踊らせたりするよう求めると、モデルはフレームに存在しない体の姿勢を創り出さなければならず、不自然に見えます。繊細な微細動作は信憑性のある仕上がりになり、ドラマチックな動作はそれをすでに暗示している元画像にこそふさわしいものです。元画像が硬すぎる場合は、先に編集しましょう——例えば、フォーマルな証明写真をキャンバス上の編集モデルに通してより自然なポーズにしてから、動画化するといった具合です。
Astorieでは、静止画を動かすことは一度きりの賭けではなく、一括展開です。1枚の元画像をKling 3.0、Seedance 2.0、Ray 2に同時に接続し、並行して実行します。すべてのテイクはバージョントレイに集まるので、動き、顔、カメラワークを並べて比較し、1つのモデルを何度も再生成する代わりに、最良のものを残すことができます。
ワークフロー全体が1つのブラウザベースのキャンバス上にあるため、上流の工程も同じ場所で組み立てられます:まず画像ノードで静止画を生成または編集し、それをそのまま動画ノードに送り込む——ダウンロードも、再アップロードも、ツールの切り替えも不要です。クリップが完成したら、単体で書き出すか、お好みの編集ソフトで仕上げるためのNLE/タイムライン書き出しを含め、タイムラインに送りましょう。
Astorieは画像、動画、音声、3D、テキストにまたがる50以上のモデルをホストしており、個人・チーム/ワークスペース双方の課金と、デュアル残高のクレジットシステムに対応しています。この幅広さこそが重要なポイントです:静止画を動かすことが最後の工程になることはめったになく、画像生成、画像から動画への変換、音声、書き出しを1つのキャンバス上にまとめることこそが、1枚の写真を完成したショットへと変えるのです。

Kling
Kling 3.0は、人物が写った画像にアニメーションを付けるうえでAstorie上最良のモデルです。Proティアは、あらゆる画像から動画へのモデルの中でもっとも自然な表情、身体の動き、髪の物理表現を生成します。ティアはStandard(高速な試行錯誤向け)とPro(納品レベルの出力向け)の2種類です。人の顔における品質差は歴然としています——Proは、まばたきのリズム、口角の上がり方、わずかな首の傾きといった微表情まで再現し、それが「いかにもAI」と「え、これ本物?」の分かれ目になります。人物のいない風景や物体であれば、Standardで十分です。
ByteDance
ByteDanceによるSeedance 2.0は、ドラマチックで高エネルギーな画像アニメーションに最適化されています——Kling 3.0も無難にこなせる種類のダイナミックなアクションを、Seedanceは飛び抜けてうまく処理します。マントがはためく、剣が振られる、パーティクルが爆発する、環境が破壊される——Seedanceはこうした表現を、滑らかで映画的なクリップに変えます。モデルには3つのティアがあります。素早い動きの探索向けのFast、公開に耐える品質のStandard、そして最大限のディテールを求めるSeedance 2 Proです。21:9の超ワイドスクリーンを含む6種類のアスペクト比に対応し、画像から動画への変換とテキストから動画への変換の両方で使えます。Omni Proバリアントはさらに、動画から動画への変換と参照画像にも対応し、より高いコントロールが可能です。
Luma
Luma Ray 2は、Astorieにおけるカメラ主導の画像アニメーションのスペシャリストです。Kling 3.0が被写体(人物、物体)を動かすことに長けている一方、Ray 2はカメラを動かすことに長けており、デジタルエフェクトというより本物の撮影監督の仕事のように感じられる、滑らかなドリー、オービット、ズーム、パンを生み出します。また、他のモデルには再現できない独特のフィルムらしい質感(自然な粒状感、映画的なカラーグレーディング)も加わります。Ray 2は5秒のクリップに対して3段階の解像度ティア(540p、720p、1080p)を提供しており、各段階で出力のディテールとレンダリング時間が増していきます。より軽量なRay Flash 2バリアントは、フルのRay 2より速く540pで生成できるため、高解像度の最終レンダリングに進む前にカメラアングルをテストするのに便利です。
写真を画像から動画へのAIモデルにアップロードし、欲しい動きだけを説明する短いプロンプト(例:「髪が風に揺れる、カメラがゆっくり前に寄る」)を書いて、短いクリップを生成します。AIはあなたの画像をそのまま保ちながら、その上に自然な動きを加えます。Astorieでは、画像ノードを動画ノードに接続するだけでブラウザ上でこれを行えます——GPUもインストールも不要です。
画像から動画への変換(img2vid)を使います:モデルはテキストではなくアップロードした画像から始まるため、被写体と色は固定されたまま動きが生成されます。被写体に合ったモデルを選びます——顔にはKling 3.0、アクションやイラストにはSeedance 2.0、映画的なカメラワークにはLuma Ray 2——そして運動専用のプロンプトを書いて5秒のクリップをレンダリングします。
被写体によって異なります。2026年現在、人の顔と自然な表情の機微にはKling 3.0 Pro、高エネルギーなアクションやアニメ・イラストにはSeedance 2.0、映画的なカメラの動きと奥行きにはLuma Ray 2が最適です。Astorieでは1枚の画像を3つすべてに同時にかけて、1つに絞り込む前に最良の結果を残すことができます。
はい。AIで静止画をアニメーション化するのに編集やアニメーションの経験は必要ありません——画像をアップロードし、1行の運動プロンプトを入力すれば、モデルが動きを生成します。より難しいのは運動専用のプロンプト(動詞とカメラ方向を使い、シーンを再説明しない)を書くことで、これは上記のガイドで順を追って解説しています。
動きを暗示する画像の方がはるかに説得力のある仕上がりになります:歩いている途中の人物、風になびく髪、今にも砕けそうな波は、モデルに続きの動きを与えますが、硬直して左右対称でフォーマルにポーズを取った写真は、モデルにゼロから動きを創り出させることになります。元画像が静的すぎる場合は、動かす前にキャンバス上でより躍動感のあるポーズに編集しましょう。
Kling 3.0、Seedance 2.0、Ray 2を含むほとんどの画像から動画へのモデルは、1クリップあたり約5秒でレンダリングします。より長いシーケンスにしたい場合は、ショットを複数の5秒クリップとして計画し、タイムライン上で組み立てましょう——AstorieはNLE/タイムライン書き出しに対応しているので、お好みの編集ソフトで仕上げの編集ができます。
いいえ、異なります。テキストから動画への変換は言葉だけからクリップを生成しますが、静止画のアニメーション化(画像から動画への変換)はあなたの写真そのものから始まり、被写体、色、構図をフレームごとに保ちながらその上に動きを加えます。特定の写真、商品、キャラクターの見た目をそのまま保つ必要がある場合は、常に画像から動画への変換を使いましょう。