·7

Spotify CanvasをあらゆるAIでアルバムカバーからアニメーション化:Veo、Kling、Higgsfield、Seedance用プロンプト

静止画のカバーをSpotify Canvasに変換できるビデオAIはたくさんあります — Veo 3、Kling 2、Higgsfield、Seedance、Runway。プロンプトが結果をどう左右するか、そして今日から使えるコピペ用プロンプトをご紹介します。

Spotify Canvasは、モバイルでトラックの背景に流れる3〜8秒の短い9:16動画に過ぎません。つまり、専用ツールは厳密には必要ありません — 最新の画像から動画へのAIなら技術的には制作可能です。Veo 3、Kling 2.x、Higgsfield、Seedance、Runway Gen-4、Luma Ray、Pika — これらすべてがカバーを受け取ってアニメーション化できます。

問題は、結果が大きく異なることです。実際に得られる結果を決めるのは2つの要素 — 選択するモデルと書くプロンプトです。このガイドでは両方について説明し、各主要モデル向けに調整されたコピペ用プロンプトを提供しますので、ご自身で試すことができます。

モデルが思っている以上に重要な理由

すべてのビデオモデルには個性があります。Veo 3(Google)は映画的で物理的にもっともらしい傾向があります — 写実的な写真カバーには最適ですが、イラストアートワークには向いていません。リアリズムに「修正」しようとする傾向があるためです。Kling 2.xは現在、入力画像のスタイルを保持する能力が最も高く、イラストや絵画のカバーにとって安全なデフォルトとなっています。Higgsfieldはカメラ移動プリセット(プッシュイン、オービット、パララックス)に特化しており、被写体のアニメーションではなく制御された映画的な動きが必要な場合に優れています。Seedance(ByteDance)は高速で安価、スタイライズされた2Dに驚くほど優れていますが、顔では変化することがあります。Runway Gen-4はオールラウンダーで、テキストやロゴの処理が他のほとんどよりも優れています。

カバーに合ったモデルを選びましょう。写真的で雰囲気のあるポートレート?VeoまたはRunway。手描きまたは絵画?KlingまたはSeedance。静止シーンで制御されたカメラ移動が必要?Higgsfield。

結果が毎回異なって見える理由

画像から動画への変換は非決定論的です。同じプロンプト、同じモデル、同じ画像でも、実行するたびに異なるクリップが生成されます — 微妙な違いの場合もあれば、劇的な違いの場合もあります。手が歪みます。顔が変わります。背景に元々なかった詳細が生まれます。これはバグではなく、2026年の拡散ビデオの仕組みです。

どのカバーでも3〜5回生成して最良のものを選ぶ計画を立てましょう。予算を組んでください:Veo 3の1回の生成には数ドルかかることがあります;KlingとSeedanceは安価ですが、それでも積み重なります。生成結果が90%正しいが1フレームだけ壊れている場合は、再試行してください — 後処理で修正しようとしないでください。

すべてのモデルで機能するプロンプトの構造

モデルに関係なく、Canvasプロンプトには4つの部分があります:被写体の動き(何が動くか)、速度(どれくらい速いか)、カメラ(カメラも動くか?)、スタイルロック(何を変更してはいけないか)。スタイルロックはほとんどの人がスキップする部分であり、カバーが別の画像のように見えてしまう理由です。

あなたや視聴者が英語話者でなくても、プロンプトは英語で書いてください。すべての主要なビデオモデル(Veo、Kling、Higgsfield、Seedance、Runway、Luma、Pika)は主に英語のキャプションで訓練されており、英語の指示により正確に従います — 英語以外のプロンプトは内部で翻訳され、特にカメラの動きやスタイルロックに関してニュアンスが失われます。プロンプトは英語のままにしてください;出力は単なるピクセルなので、リスナーには違いがわかりません。

テンプレート:"[Subject] [does motion] [slowly/gently]. [Camera instruction]. Preserve original art style, colors, composition, and character design. Loop. Vertical 9:16."

モデル別コピペ用プロンプト

以下は各モデルの癖に合わせて調整されたプロンプトです。括弧内の部分をカバーに実際にあるものに置き換えてください。それぞれを2〜3回実行して最良のものを保持してください。

Veo 3(Google、Gemini / Vertex / Flow経由)

Veoは映画的で説明的な言語を求め、カメラの指示によく反応します。動きを控えめにしないと、過度にアニメーション化されます。

"Cinematic subtle motion on a still album cover. [Subject, e.g. the character in the foreground] [action, e.g. breathes slowly, hair drifting in a faint breeze]. Background [action, e.g. soft volumetric light shifts, dust particles float]. Camera: extremely slow push-in, almost imperceptible. Maintain the exact art style, color palette, and composition of the source image. No new objects, no style change. 5 seconds, vertical 9:16."

Kling 2.x(Kuaishou)

Klingは主要モデルの中で最もスタイルに忠実であり、現在多くのアニメーションイラスト作品の背後にあるデフォルトとなっている理由です。プロンプトは短く具体的に保ちましょう — 長いものは考えすぎてしまいます。

"[Subject] [gentle action, e.g. blinks slowly and the smoke behind them drifts upward]. Subtle, dreamy motion. Keep original illustration style, line work, and colors unchanged. Static camera. Loop. 5s, 9:16."

Higgsfield

Higgsfieldの強みはカメラモーションプリセットです — カメラを言葉で説明するのではなく、1つを選択してください。「Slow Push In」や「Parallax」のようなプリセットと、被写体の動きに関する小さなメモを組み合わせます。

"Preserve the album cover exactly. [Subject] [tiny motion, e.g. the neon sign flickers once, the water in the foreground ripples gently]. Keep all characters, typography, and composition identical to the source. Loopable, 9:16, 5 seconds." 次にカメラプリセットを選択します(Slow Push InまたはParallaxが通常Canvasには最適です)。

Seedance(ByteDance / Doubao)

Seedanceは高速で安価、プロンプトのアイデアをテストするのに最適です。2Dやアニメスタイルのアートを特によく処理します。顔では変化することがあるため、カバーにポートレートがある場合は顔よりも環境をアニメーション化するプロンプトを優先してください。

"Animate this cover with calm, looping motion. [Environment action, e.g. clouds drift slowly across the sky, light flickers on the water]. [Subject action, e.g. the figure's coat sways gently]. Do not change the art style, colors, or character. 9:16 vertical, 5 seconds."

Runway Gen-4 / Luma Ray / Pika

この3つは十分に似た動作をするため、1つのプロンプトテンプレートでカバーできます。強力なオールラウンダーで、カバー上のテキストを他のほとんどよりもうまく処理します。

"Subtle living-photo motion on this album cover. [Subject] [small action]. Background [small action]. Preserve every element of the original image — style, color, characters, typography. No camera movement, or extremely slow drift only. vertical 9:16, 1080×1920."

生成後:Spotify用にフォーマット

どのモデルを使用しても、Spotify Canvasには正確に1080×1920のMP4、3〜8秒、にループし、約8MB未満が必要です。ほとんどの汎用ビデオモデルは720×1280または1080×1920でエクスポートしますが、常に適切な長さやクリーンなループではありません。Spotify for Artistsにアップロードする前に、Handbrake、CapCut、ffmpegなどでトリミング、スケーリング、再エンコードが必要になる可能性があります。

または、これらすべてをスキップ:animatecover.com

上記のすべては機能しますし、試してみることを心からお勧めします — 想像したループが得られるまでプロンプトと格闘するのは楽しいものです。しかし、モデル選択も、アスペクト比の修正も、静かに40ドルになる試行錯誤の予算もなく、アップロード準備が整ったCanvasが欲しいだけなら、それがまさにAnimateCoverが構築された目的です。

AnimateCoverはSpotify Canvas専用に構築されています:カバーに適したモデルを自動的に選択し、出力を1080×1920にロックし、なループを保証し、Spotify対応のMP4をエクスポートします。典型的なカバーは単一のVeo生成のほんの一部のコストで、結果が気に入るまで安価に再生成できます。カバーをアップロードし、どのように動くべきかについて短い一行を書けば、数分でCanvasが完成します。