• テクノロジー

Wan 3 対 Seedance 2.5 対 MiniMax H3:AI動画の比較

  • Felix Rose-Collins
  • 31 min read

はじめに

AI動画技術は、もはや単一のデモではほとんど何も証明できない段階に達しています。どのシステムでも、スマートフォンの画面上では完成品のように見える10秒間の映像を生成することは可能です。しかし、人がフレーム内を横切ったり、カメラが移動し始めたり、2つの物体が衝突したり、あるいはプロンプトで同時に複数の出来事が求められるようになった瞬間に、その差が明らかになります。そこでは、品質は単なる静止画ではなく、動作そのものとして評価されるようになるのです。

ここでは、Seedance 2.5、MiniMax H3、Wan 3を、マーケティング製品としてではなく、負荷がかかった状態での動画生成エンジンとして扱います。ラウンドが始まる前に、3つの明確な指標が対決の枠組みを示しています。MiniMax H3は現在、検証可能な品質において最も強固な地位を確立しています。というのも、3つの中で唯一、公開されているベンチマークでの順位とダウンロード可能な重み付けデータを持っているからです。

Seedance 2.5は、公開動画ランキングでトップに立ったSeedanceシリーズから受け継いだ、最も優れたモーションとストーリーテリングの実績を誇ります。Wan 3は、公開中の商用エンドポイントと注目すべき再生時間を備えつつも、メーカー自身が一度も公開したことのない仕様の霧に包まれているため、3つの中で最も評価が分かれる存在です。

勝者はまだ明らかになっていません。各ラウンドの結果で決まりますが、証拠の偏りが激しいため、3つのうち1つについては品質に関する評価を全く行うことができません。

Seedance 2.5、ByteDance

Seedance 2.5

ByteDanceは2026年7月31日、Seedance 2.5をリリースした。6月23日のVolcano Engine FORCEカンファレンスでのプレビューを経て、Jimeng(Dreamina)およびDoubaoのProプランを通じて展開された。 主な機能は、ネイティブの30秒シングルパス音声・動画生成であり、より長いシーケンスのためのマルチターン拡張機能を備え、最大50のマルチモーダルリファレンス(画像30枚、動画クリップ10本、音声クリップ10本)までの入力上限があり、このカテゴリーで最も広いリファレンス予算となっている。 重み付けパラメータは非公開です。執筆時点では、パブリックAPIはまだ公開されていません。ByteDanceは開発者に対し、8月上旬にアクセスが開放される見込みの「BytePlus ModelArk」を利用するよう案内しています。MiniMax 2.5に関する独立したベンチマークはまだ存在しませんが、その前身であるSeedance 2.0は公開ランキングの上位に位置しています。

MiniMax H3(別名:Hailuo 3.0)

MiniMax H3

MiniMaxは、7月17日のWAICでのプレビューを経て、Seedance 2.5と同じ7月31日にH3を一般公開した。 公式モデル名はMiniMax H3ですが、クリエイターの多くが使用するアプリ名は「Hailuo 3.0」です。このモデルは、最大ネイティブ2K(2560×1440)、24fpsの4~15秒のクリップを生成し、同一パスで32kHzのステレオオーディオを生成します。また、最大9枚の画像、3つの動画クリップ、3つのオーディオクリップを取り込むオムニリファレンスシステムを採用しています。 Artificial Analysisのリーダーボードでは、テキストから動画生成部門で2位、画像から動画生成部門で3位、動画編集部門で1位にランクインしている。2026年8月3日、MiniMaxはHugging Faceにオープンウェイト(330億パラメータのトランスフォーマー)を公開したが、後述する重要な注意点がある。コミュニティライセンスでは、ローカル展開に関していくつかの主要な法域が除外されている。

Wan 3、アリババ

Wan 3

Ranktrackerの紹介

効果的なSEOのためのオールインワン・プラットフォーム

ビジネスが成功する背景には、強力なSEOキャンペーンがあります。しかし、数え切れないほどの最適化ツールやテクニックがあるため、どこから手をつければいいのかわからないこともあります。でも、もう心配はありません。効果的なSEOのためのオールインワンプラットフォーム「Ranktracker」を紹介します。

Ranktrackerの登録がついに無料になりました。

無料アカウント作成

または認証情報を使ってサインインする

Wan 3は、現在のAI動画分野において最も過剰に説明されているモデルです。検証可能な事実は以下の通りです:

アリババは自社のQwen Cloudプラットフォーム上でこれを「wan3.0-video」として掲載しており、稼働中のDashScopeエンドポイント、秒単位の料金体系、およびテキスト、画像、音声、動画の各入力に対して最大30秒という制限が設けられている。 検索結果の1ページ目を独占しているにもかかわらず、事実ではない点は以下の通りです:4K対応ではありません(価格表には480p、720p、1080pの料金プランしか記載されていません)、オープンウェイトではありません(Apache 2.0ライセンスでリリースされた最新のWanフラッグシップモデルは1年以上前のWan 2.2です)、そしてどこにも独立したベンチマーク結果が掲載されていません。

一見似たようなドメイン群が、自信満々の仕様表(ネイティブ4K、27Bまたは60Bのミックス・オブ・エキスパートアーキテクチャ、2026年4月のオープンリリース)を公開しているが、これらは公式情報源に遡ることができず、互いに矛盾している。 4Kを搭載して出荷されたモデルであれば、4K相当の価格設定がなされるはずだ。そのグレードが存在しないという事実は、いかなるマーケティング上の主張よりも強力な証拠である。今回の対決において、Wan 3は、実際の持続時間の上限があり、品質が不明な「呼び出し可能な製品」として競合している。

スコアボード

比較は7つの次元で構成される。各次元は100点満点で評価されており、数値は仕様から機械的に算出されたものではない。これらは入手可能な証拠の強さを表しているため、単一の数値ではなく範囲が示されており、Wan 3についてはその範囲が急激に広がっている。接戦のスコアは実験室での測定値ではない。その唯一の役割は、比較上の違いを一目で分かりやすくすることにある。

評価基準 Seedance 2.5 MiniMax H3 Wan 3(暫定)
画質 86~91 89~93 77~88
動き 85~90 84~89 76~86
シーンの安定性 85~90 85~90 79~88
プロンプトの実行 85~90 87~92 77~87
カメラの挙動 85~90 84~89 77~86
人間の一貫性 86~91 86~91 77~87
創造性の幅 84~89 87~92 78~88

表1. 初期スコアボード。範囲は測定精度ではなく、証拠の信頼度を反映している。

Table 1

図2. 同じスコアボードを横軸の範囲で表示したもの。点は各範囲の中間点を示している。Wan 3のバーが幅広くなっているのは、その品質が確認されている部分が極めて少ないためである。

Figure 2

Ranktrackerの紹介

効果的なSEOのためのオールインワン・プラットフォーム

ビジネスが成功する背景には、強力なSEOキャンペーンがあります。しかし、数え切れないほどの最適化ツールやテクニックがあるため、どこから手をつければいいのかわからないこともあります。でも、もう心配はありません。効果的なSEOのためのオールインワンプラットフォーム「Ranktracker」を紹介します。

Ranktrackerの登録がついに無料になりました。

無料アカウント作成

または認証情報を使ってサインインする

図3. 範囲の中間点を用いた能力分布。Seedance 2.5は動きとカメラワークに偏り、MiniMax H3は映像、プロンプト、範囲に偏っている。Wan 3は、実証された弱点があるためではなく、証拠が不足しているため、すべての軸で後れを取っている。

第1ラウンド:ワンショットの美しさテスト

課題は意図的に簡単なものに設定した:映画的な照明の下の人物、風景、高級なインテリア、スローなクローズアップ。重要なのは、どのモデルが最も説得力のある最初のフレームを生成し、その品質をショットの全編にわたって維持できるかという点だ。シャープネスはリアリズムではない。過度に処理された肌、プラスチックのような微細なディテール、不安定なテクスチャは、サムネイルでは印象的に見えても、動きの中で崩れてしまうことがある。

この点において、MiniMax H3が最も明確な実績を示している。ネイティブ2K出力は単なる主張ではなく、文書化された仕様であり、テキストから動画への変換ランキングで2位を獲得したのも、完成された単一ショットの見た目が評価された結果である。 Seedance 2.5も明らかに高品質な映像をターゲットとしており、その系譜から見て優れた結果が期待されますが、ByteDanceは発売時に2.5の2K解像度に関する数値を公表しなかったため、その最高レベルのシャープネスは確認されたものではなく、推測の域を出ません。Wan 3は、文書で明記されている1080pが上限であり、一歩及ばない水準です。

**このラウンドの勝者:MiniMax H3。**最も近い挑戦者:Seedance 2.5。その理由は単純明快だ。H3は、実証可能なほど美しいフレームではなく、文書で明記された解像度という数値で勝利を収めたからである。

第2ラウンド:実際に動く人物

難易度が上がる。歩く、方向転換する、走る、踊る、座る、立つ、物を拾う、両手で物を渡す。このラウンドでは、美しいフレームではなく、時間的な品質が評価される。失敗の兆候としては、関節の不安定さ、足が滑ったり踏み外したりすること、手足の急激な変形、そして体重が適切に移らないことが挙げられる。

公開されている並列比較テストは、このラウンドにおいて最も有用な単一の証拠である。その中で、Seedance 2.5は最速の動きにおいても追従しやすく、カメラがスイープする間も、赤い髪の白い衣装を着た被写体は認識可能だった。H3はより攻撃的なショットのバリエーションと鋭いカットを追求しており、エネルギッシュには見えるが、それは別の強みである。どちらの結果も振り付けの問題を解決できていなかった。ガードの姿勢がずれていたり、一部の反応には目に見える原因が欠けていたりした。 動きが単なるアニメーションではなく、意図的なものとして感じられるかという限定的な観点では、Seedanceがわずかに優勢だった。

**ラウンド勝者:Seedance 2.5。**高速動作下での動きの明瞭さはSeedanceシリーズの伝統であり、今回得られた唯一の直接比較結果もそれを裏付けている。

第3ラウンド:カメラが動き始める

トラッキング、プッシュイン、プルアウト、オービット、パン、ティルト、ローアングルでの移動、動く被写体の追跡。試されるのは、視点が変わってもシーンの構造的な安定性が保たれるか、そしてカメラの動きがプロンプトで求められたものか、それともたまたま映画的な印象を与えるだけの無作為な映像的ドリフトではないかという点だ。

Seedance 2.5は、前バージョンから明示的なAIカメラ制御を引き継ぎ、視点やカメラ編集を第一級の制御要素として追加しています。 同じ比較テスト映像では、被写体が広範囲な動きの中でも同一性を保っていることが確認されました。これはまさに、今回のラウンドが対象とする背景再構築の問題そのものです。H3は動きをうまく処理し、映画的なリズムのカメラワークを特徴としていますが、その制御方法はより一般的な用語で記述されています。要求されたカメラ動作と偶発的なカメラ動作を比較すると、カメラの方向を明示的に示すモデルの方が有利となります。

**ラウンドの勝者:Seedance 2.5。**文書化されたカメラ制御が、映画的な動きという一般的な約束を打ち負かした。

第4ラウンド:一度に起こりすぎる出来事

このラウンドでは、状況を混乱させることを試みます。3人以上の人物、群衆、賑やかな通り、レストラン、工場、祭り、市場、交通などです。評価基準は、シーンの構成、被写体の持続性、背景の一貫性、オブジェクト数、そしてモデルが複数の同時指示を維持できるかどうかです。要求されたシーンの半分をさりげなく省略してしまうような見事なクリップは、高得点を得るべきではありません。

ここで証拠は率直なものとなる。ByteDance自身も、複雑な物理的動きや、非常に多くの被写体が相互作用するシーンにはまだ改善の余地があると指摘しており、これはSeedanceに関する稀有かつ有益な認容である。H3には群衆に特化したベンチマークがなく、その強みはよりクローズアップされたショットで発揮される。密集したシーンにおいて、両者を確信を持って区別できる記録は何もなく、どちらも明らかに処理に苦労している。

**ラウンド結果:引き分け。**群衆の処理は両者にとって未解決の問題であり、そうでないふりをすることは、まさにこの記事が回避しようとしている「デモへの過剰な賛辞」そのものである。

第5ラウンド:手、物体、接触

最も難しいセクションの一つだ。飲み物を注ぐ、箱を開ける、携帯電話を持つ、道具を使う、料理をする、書く、物を渡す、他者に触れる、小さな製品を扱う。注目すべきは物理的な相互作用の瞬間だ:指の変形、物体同士の融合、消えたり形が変わったりする物体、不可能な接触、握りが崩れる場面など。このラウンドこそが、広告や製品映像が大幅な後処理なしに使えるかどうかを決定づける。

3つのモデルのいずれにおいても、多様なプロンプトに対して信頼できる手と物体の接触を実証した信頼できるソースは存在しない。接触はばらつきが最も大きく、都合の良い部分だけを選りすぐるのが最も容易なため、1つの成功したクリップだけでは何も証明できない。H3のテスターは特定のショットでクリーンな結果を報告している。Seedance 2.5の領域レベル編集機能は、接触に失敗した際の修復手段を提供するが、これは生成能力の優位性というよりはワークフロー上の利点である。いずれも確固たる勝利を収めたとは言えない。

**ラウンド結果:慎重に見て引き分け。**1つのクリップでの成功は、キャンペーン全体にわたる信頼性を意味するものではない。

第6ラウンド:プレッシャー下での物理演算

水しぶき、煙、炎、布、風になびく髪、落下物、回転する車、跳ねるボール、注がれる液体、破壊される物体、風。生成動画は、物理モデルを一切使用せずに、一見説得力のある動きを日常的に生成するため、判断基準は「物理的な信憑性」——運動量、重力、衝突挙動、流体の連続性、物質の実際の挙動——となります。

これは宣伝ではなく分析であり、率直に言えば、3社とも物理演算に関する評価結果が公表されていない。Seedanceのモーション技術の実績は、運動量と流動性において優位性を示唆しているが、ByteDance自身が複雑な物理的動きについて述べている注意書きが、その示唆を同時に和らげている。H3の物理挙動は、大規模な場面では実証されていない。Wan 3については、測定データが全く存在しない。

**ラウンド結果:引き分け。**物理的な信憑性は、このカテゴリー全体において依然として最も脆弱な部分であり、どの候補もそれを主張するに足る実績を上げていない。

第7ラウンド:キャラクターのアイデンティティ

人物は、1つのクリップを通じて、さらに難しいこととして、異なる世代をまたいで認識できるか? 顔の構造、髪型、服装、アクセサリー、見かけの年齢、プロポーション、肌。これがショートフォームドラマの成否を分けるポイントであり、4カット目で顎の位置が0.5センチずれただけで、視聴者は離れてしまうからだ。

両モデルとも参照システムを用いてこの課題に取り組んでおり、この点において証拠は静かにH3を支持している。画像、動画クリップ、音声を用いてH3のオムニリファレンスで実際のプロジェクトを実行した実地テスターは、キャラクターの一貫性が予想以上に優れており、画面上のテキストも鮮明であると報告した。また、H3はアイデンティティの保持と密接に関連する動画編集分野でもトップの座を占めている。 Seedance 2.5は、最大50アセットというはるかに大きな参照予算と、制作レベルの一貫性制御を対抗策として掲げていますが、バージョン2.5に関しては、それは実証された結果というよりはベンダー側の主張にとどまっています。参照容量の拡大は有望ですが、テスターによる実証済みの結果の方が説得力があります。

**このラウンドの勝者:MiniMax H3。**実証済みの整合性は、規模は大きいが未検証の参照上限よりも優先されます。参照画像の制御は両製品の結果に影響を与えるため、それなしに同一性が維持されるとは想定すべきではありません。

第8ラウンド:プロンプトへの即応性

プロンプトの形式が異なれば、評価されるモデルも異なります。単純な視覚的なライン、物語形式、カメラワークを重視した指示、アクションを重視した指示、密度の高い映画的な描写、そして一連のアクションを含むプロンプトなどです。審査では、指示の定着度、被写体とアクションの正確さ、環境、スタイル、カメラワークの順守、および時間的順序が評価されます。指示を無視した見事な動画は、成功ではなく失敗です。

H3には2つの具体的な利点がある。テキストから動画生成のランキングで2位を獲得していること自体が、指示の順守度を示す指標であり、そのAPIには7,000文字のプロンプト制限が明記されており、真に多層的な指示を与える余地がある。Seedance 2.5は指示を忠実に実行し、強力な多言語サポートを備えており、そのタイムスタンプ制御は、定義された瞬間に実行されなければならない一連のアクションという特定のサブケースにおいて極めて優れている。 プロンプトの形式を問わず一般的な指示遵守能力においては、測定されたモデルがリードしているが、タイムコード付きアクションシーケンスに特化すれば、Seedanceの方がより鋭いツールである。

**ラウンド勝者:MiniMax H3。**堅実なプロンプト追従性能に加え、非常に大きなプロンプト予算を備えており、アクションをビートに合わせてタイミングを合わせる必要がある場合はSeedanceが最適です。

第9ラウンド:映像的直感

測定不可能な要素:ショットの構図、照明の選択、雰囲気、スケールの感覚、カメラのリズム、色彩の関係性、ドラマ性、視覚的なストーリーテリング。このラウンドの根底には、ある本質的な問いが横たわっています。あるモデルは素朴なプロンプトをさりげなく美しく仕上げる一方、他のモデルは指示を文字通り忠実に実行します。自動的な強化機能は、指示が曖昧な場合には恩恵となりますが、指示が正確でモデルがそれを上書きしてしまう場合には、むしろ足かせとなります。

Seedanceの系譜は映画的な作品に深く根ざしており、その明確なカメラおよび視点設定ツールにより、クリエイターはモデルが好むままに任せるのではなく、リズムを自ら演出することができます。H3は映画的なリズムを備えた見栄えの良い結果を生み出しますが、自動的な仕上げに傾きがちで、これはカジュアルなプロンプトには適していますが、要求の厳しいプロンプトでは逆効果になる可能性があります。カメラに計画通りに動いてほしいと考えるクリエイターにとっては、操作性の良さからSeedanceが優位となります。

**このラウンドの勝者:Seedance 2.5。**単なる映画的な見た目だけでなく、映画的なコントロールも実現。

第10ラウンド:スタイリッシュなコンテンツ

フォトリアリズムだけが試金石ではありません。アニメ、イラスト、ファンタジー、シュールなシーン、クレイアニメ、3Dアニメーション、コミック風のビジュアル、絵画的な動画など。真の課題は、視覚的なルールが意図的に非現実的である場合でも動きの一貫性が保たれるかどうか、そしてどのモデルが写実的な映像の枠を最も大きく超えられるかということです。

H3は、リアリズムを最優先とする動画エンジンというよりは、汎用的なオムニモーダル生成モデルとして構築されており、その枠組みこそが、幅広いスタイルの範囲に求められるものです。Seedance 2.5は、商業的・物語的なリアリズムを目的とした制作システムとして位置付けられており、これは他の分野では強みですが、ここではやや範囲が狭まります。非写実的なスタイル全般にわたる範囲という点では、汎用モデルの方がより広い表現の幅を持っています。

**このラウンドの勝者:MiniMax H3。**汎用的な設計は、制作向けに最適化されたモデルよりも幅広いスタイルをカバーします。

第11ラウンド:コマーシャル動画

有償のクリエイターの視点から評価。香水広告、スニーカーCM、食品プロモーション、自動車、ファッションキャンペーン、ハイテク製品のローンチ、旅行スポット。評価基準は、製品の整合性、制御された動き、ラグジュアリーな美学、再利用性、そして出力物にどれだけのポストプロダクション作業が必要かです。テキストは正直なところ最大の難点です。これらのモデルはいずれも、タイポグラフィやロゴを確実に保持できるとは限らないため、画面上のブランディングは生成するのではなく、後で合成すべきです。

Seedance 2.5は、まさにこの課題を解決するために設計されています。領域単位の編集機能により、パフォーマンスや照明を損なうことなくフレームの一部を再描画でき、グリーンスクリーン編集では被写体を固定したまま背景を差し替え、ホワイトモデル制御機能では、ライティング処理の前にテクスチャのないジオメトリでショットをブロックできます。 これは単なるジェネレーターではなく、商用向けの制御スイートです。H3はネイティブ2K対応、テスターレポートでの鮮明なテキスト、フルリロールを回避する指示ベースの編集といった点で対抗していますが、Seedanceのツールセットは、広告ショットが実際に構築・修正されるプロセスにより直接的に対応しています。

**このラウンドの勝者:Seedance 2.5。** 領域編集、グリーンスクリーン、ホワイトモデルによるブロックは、広告制作チームがすでに日常的に活用している制作コントロール機能です。

第12ラウンド:ショートフォーム・ソーシャル

TikTok、Reels、Shorts、縦型広告、クリエイター向けBロールへの有用性。評価基準は、スピード、視覚的なフック、縦型フレーミング、高速モーション、多数のバリエーションを容易に生成できること、およびバッチ全体での一貫性です。このラウンドでは、シネマティックなラウンドとは異なる勝者が決定される可能性がありますが、これは矛盾ではなくむしろ歓迎すべきことです。

H3の仕様はショートフォームにほぼ完全に適合しています。4~15秒のクリップはこのフォーマットのネイティブ長であり、2K解像度なら縦向きにトリミングする余裕があり、音声も同時に取得でき、指示ベースの編集により、クリエイターは一から作り直すことなくバリエーションを反復して作成できます。Seedance 2.5の30秒のワンテイクは、ほとんどのショートフォームのニーズを上回る長さであり、その真価はより長く、より演出性の高い作品に向いています。 縦型コンテンツを大量に制作する場合、H3の方がより自然な選択肢となります。

**このラウンドの勝者:MiniMax H3。**ネイティブのショートクリップ長、2Kクロップの余裕、ワンパスでの音声収録、そして迅速なバリエーション作成。

このラウンドの集計結果、そしてなぜこれが決定的な結論にはならないのか

12ラウンドの結果、僅差の割れ目が見られました。MiniMax H3が5勝、Seedance 2.5が4勝、3ラウンドは真に未解決の問題で引き分けとなり、Wan 3は0勝でした。Wan 3の空欄は、その性能が弱いという判定ではありません。その品質が未検証であるという判定です。検証可能な品質の証拠がないモデルにラウンドを授与することはできず、バランスを取るために勝利をでっち上げることは、この手法の精神に反するからです。

round tally

図4. ラウンド別勝敗集計。H3の勝利は、検証可能な強み(解決力、実証された一貫性、測定されたプロンプト順守度、範囲、ショートフォーム)に集中している。一方、Seedanceの勝利は、モーションの技巧やコマーシャル制御のツールに集中している。

ここで指摘すべき真の緊張関係が存在する。最も難易度の高い技術ラウンドのいくつか――モーション、カメラ、コマーシャルコントロール――において、Seedance 2.5はより強力な純粋なビデオエンジンに見える。しかし、後に証拠の重み付けに基づいて決定される総合優勝は、単にラウンド数の多寡に従うものではない。各ラウンドは、各ベンダーの証拠とポジショニングが最も強い領域を測定するものである。チャンピオンシップは、どの品質が実際に検証され、どのアクセスが実際に現実のものかを測定するものである。

各モデルが依然として破綻する点

あらゆる生成型動画モデルには、決まったパターンで破綻する箇所がある。これらは、利用可能な証拠と最も整合性のある失敗の特徴であり、整然としたバランスを強要するためにでっち上げられた弱点ではない。

Seedance 2.5

最も信憑性の高い2つの弱点は、ByteDance自身の枠組みと、より広範な実績から生じています。それは、多くの対象が相互作用する密度の高いシーンと、複雑な物理的動作であり、開発元もこれらについては改善の余地があることを認めています。 手と物体の接触は、この分野全般と同様に、さまざまなプロンプトにおいて依然として信頼性が低い。また、ピクセルとは全く関係のない実用上の問題もある。執筆時点ではパブリックAPIが公開されていなかったため、出力の品質にかかわらず、自動化パイプラインへの統合が阻まれていた。

MiniMax H3

最大のリスクは、レンダリングの問題というよりはライセンスに関する問題だ。オープンウェイトでは、米国、欧州連合(EU)、英国、韓国でのローカル展開が除外されており、動作する最小のローカル環境でも短辺768ピクセルでのネイティブ実行にとどまる。真の2K解像度は、ダウンロード可能なリリースには含まれていないホスト型再生成パスを通じてのみ実現される。 出力そのものに関しては、群衆表現や物理演算の性能は実証されておらず、接触処理の信頼性も低く、ネイティブでのクリップ長は15秒に制限されており、物語性のある作品には短すぎる。

Wan 3

決定的な弱点は認識論的なものです。独立したベンチマークも、技術報告書も、モデルカードも、リーダーボードでの順位もないため、Wan 3に関する品質に関するあらゆる主張は未検証のままです。 その周囲には、捏造された仕様(4K、オープンウェイト、奇抜なパラメータ数)の層が張り巡らされており、注意深い読者はこれらを積極的に無視しなければならない。唯一の確かな商業的事実は好ましくないものである。1080pでの価格は、公開ランキングにおいてアリババ独自の「Wan 2.7」を上回るすべての測定済みモデルよりも高くなっている。

仕様は、その位置に留めるべき

品質分析を経て初めて、数値をページに掲載する意義が生まれます。そのうちのいくつかは、メーカーが明記していないため「不確実」とマークされています。仕様は性能ではなく、可能性を表すものです。

属性 Seedance 2.5 MiniMax H3 ワン 3
最大解像度 2.5では未公開 2K (2560 x 1440) 1080p(価格表による)
最大記録時間 30秒(シングルパス) 4~15秒(延長可能) 30秒
ネイティブオーディオ はい はい、32 kHz ステレオ はい
画像参照 最大30 最大9 オムニモーダル、未記載
動画/音声の参照 動画10件、音声10件 動画3、音声3 対応、未記載
先頭/最終フレーム 対応 はい(両方のフレーム) 対応
ビデオ拡張機能 マルチターン延長 約30秒まで延長可能 編集/走行モード
APIの提供状況 未定(ModelArk) ライブ 稼働中 (Qwen Cloud)
ウェイトの公開 なし はい(ただし、除外事項あり) いいえ
独立したベンチマーク なし(2.0は上位) T2V第2位、編集第1位 なし

表2. 技術リファレンス。ベンダーによって明記されていない項目は、妥当な推測で埋めるのではなく、その旨が明記されている。

モデルの入手

入手可能性は、品質指標と同様に、これら3つのモデルを明確に区別する要素です。MiniMax H3は、最も入手しやすく、自動化も最も容易です。ライブAPI、公開アプリ、および対象外の管轄区域外のチーム向けにダウンロード可能な重みデータが用意されています。ただし、重要な注意点として、ローカルでの生成は768ピクセルのネイティブ解像度であり、真の2K解像度はホスト環境でのみ利用可能です。 Wan 3は、AlibabaのQwen Cloud上に商用エンドポイントがあり、価格が公開されており、同時接続数に控えめな制限(同時リクエスト2件、50タスクの非同期キュー、1分あたり30リクエスト)が設けられているため、品質リスクを受け入れれば、今日から構築を開始できます。 Seedance 2.5は利用が困難なケースです。JimengやDoubaoを通じて手動で作成することは可能ですが、執筆時点では公開APIが存在しないため、ByteDanceがModelArkへのアクセスを開放するまでは、開発者のワークフローが最初から阻まれてしまいます。

本番運用チームにとっての核心的な疑問は、モデルを通常のパイプラインに組み込めるかどうかです。3つのうち2つは、現時点で「可能」と答えています。Seedance 2.5は、その出力がどれほど優れていようとも、「まだ不可能」という答えになります。

真のコストは「使えるクリップ」1本あたりのコストである

サブスクリプション料金や1秒あたりの単価を比較するのは誤りです。重要なのは、使用可能な結果1つあたりのコストです。クリエイターが1つの許容できるクリップを得るために10回の生成を繰り返す場合、安価なモデルでもすぐに高コストになります。一方、使用可能なショットの割合が高い高価なモデルの方が、実際には安上がりな選択肢となる可能性があります。どのモデルについても、使用可能なショットの割合が測定されていないため、成功したクリップ1つあたりの正確なコストを公表することはできません。したがって、この原則は定性的に適用する必要があります。

The real cost is per clip

Ranktrackerの紹介

効果的なSEOのためのオールインワン・プラットフォーム

ビジネスが成功する背景には、強力なSEOキャンペーンがあります。しかし、数え切れないほどの最適化ツールやテクニックがあるため、どこから手をつければいいのかわからないこともあります。でも、もう心配はありません。効果的なSEOのためのオールインワンプラットフォーム「Ranktracker」を紹介します。

Ranktrackerの登録がついに無料になりました。

無料アカウント作成

または認証情報を使ってサインインする

図5. 生成1分あたりの検証済み定価。Seedance 2.5は、執筆時点でByteDanceがAPI価格を公表しておらず、プラットフォームクレジットのみが存在したため、リストから除外されている。

公表されている定価によると、MiniMax H3は2Kで1分あたり7.80ドルと、測定対象の選択肢の中で最も安価である。Wan 3は1080pで1分あたり12.00ドルであり、Alibaba独自のWan 2.7よりも約3分の1高く、公開リーダーボードでWan 2.7より上位にランクインしているすべてのモデルよりも高価である一方、独自のベンチマークは提供されていない。 品質が不明なまま、測定対象の他製品よりも高い価格設定となっているこの組み合わせは、本比較において最も顕著な商業上の注意点を示している。Seedance 2.5については、執筆時点でプラットフォームクレジットしか存在しなかったため、現時点では軸上に位置づけることができない。定性的に評価すると、H3の低価格と実証済みの品質が相まって、「使用可能なクリップあたりのコスト」において最も優れたケースとなり、一方、Wan 3は「実証されていないものに対する割高価格」であるため、最も弱いケースとなる。

案件ごとの簡易評価

映画的なショットの場合

Seedance 2.5が最適で、代替案としてMiniMax H3が挙げられる。カメラや視点の制御が自在で、映画的な系譜を持つため、ショットごとの緻密な演出に適している。H3は、精緻なカメラワークよりも、検証済みの2KフレームとライブAPIが優先される場合の代替案となる。

動きの速いシーン向け

Seedance 2.5(代替案としてMiniMax H3)。直接的なモーション比較では、高速動作下での視認性においてSeedanceが優れていました。H3のシャープなカットは、モーションの安定性というよりは、スタイル上の強みと言えます。

広告向け

Seedance 2.5を推奨し、MiniMax H3はAPIが実装され次第の代替案とする。領域編集、グリーンスクリーン、ホワイトモデルによるブロック構成は、CMの制作・修正プロセスに合致している。H3の画面上のテキスト表示の明瞭さと即時利用可能性は、SeedanceのAPIが未実装の間、実用的な選択肢となる。

人物キャラクター向け

MiniMax H3。代替案としてはSeedance 2.5が挙げられる。テスターによるオムニリファレンスの一貫性の確認と、編集ランキングでの上位入りが、Seedanceのより大規模ではあるが検証されていないリファレンス予算を上回っている。長くて複数のショットからなるシーケンス全体の連続性を最優先する場合、Seedanceが適している。

実験的なビジュアルの場合

MiniMax H3。遠隔的な代替案としてWan 3。汎用的なオムニモーダル設計は、リアリズムに最適化された制作システムよりも、様式化された作品やシュールな作品をより快適にカバーします。

開発者向け

MiniMax H3を推奨し、Wan 3を代替案とする。H3はライブAPI、文書化されたパラメータ、および許容範囲内の重みを提供する。Wan 3は、30秒のワンテイクを必要とし、品質のばらつきを許容できるチームであれば、今すぐ利用可能である。Seedance 2.5は、APIが公開されるまでは選択肢から外れる。

ローカル制御の場合

ライセンスが許す場合はMiniMax H3を、そうでない場合はWan 2.2が、セルフホスティング向けの誠実なオープンウェイトソリューションとして依然として最適です。Seedance 2.5もWan 3もウェイトが付属していないため、いずれのオンプレミス展開も選択肢にはなりません。

最終スコアボード

7つの評価軸に戻り、今回は合計値としてまとめます。このスコアボードはベンダーの野心ではなく証拠の強さを測定しているため、MiniMax H3の検証済みの位置付けにより、その合計値はSeedance 2.5をわずかに上回っています。Seedance 2.5については、バージョン2.5固有の証拠が乏しいからです。評価範囲は重複しており、これは技術力において上位2つが拮抗していることを如実に示しています。Wan 3は、評価範囲が最も広く、信頼度が最も低いため、大きく後れを取っています。

モデル 合計(700件中) 信頼度 最上位/最下位カテゴリ
MiniMax H3 602~636 中~高 長所:画質、射程/短所:カメラ
シードアンス 2.5 596~631 長所:動き、カメラ/短所:群衆
Wan 3 541~610 長所:再生時間/短所:品質が未確認

表3. 最終スコアボード。合計値は、7つの証拠加重次元範囲の合計である。

alt_text

図6. 信頼度付き総合スコア範囲。上位2つの範囲が重なっている点が重要である。優勝は圧倒的なリードではなく、証拠の重み付けによって決まる。

チャンピオン、準優勝、およびスペシャリストの選定

総合チャンピオン:MiniMax H3

H3が優勝したのは、品質が「約束」ではなく「実証」されている唯一の候補だからだ。H3は、公開されているベンチマークで高い順位を維持しており、ダウンロード可能な重み付けデータを提供し、現在動作するAPI上で動作し、測定対象の中で最もクリーンなコストパフォーマンスを誇る。また、実際のハンズオン使用においても、キャラクターの一貫性と画面上のテキストの鮮明さが実証された。 すべてのラウンドで勝利するわけではなく、明らかに最も美しく、あるいは最も映画的なエンジンというわけではありません。しかし、この対決独自のテストでは勝利を収めています。つまり、美しいデモを脇に置いたとき、実際に再現可能なパフォーマンスが確認できるモデルこそが、H3なのです。

準優勝:Seedance 2.5

Seedance 2.5は、より高いポテンシャルと最も強力な技術的根拠を備えています。直接比較した1件においてモーションの可読性が優れており、明示的なカメラ制御、このカテゴリーで最も充実した商用編集スイート、そして公開動画ランキングでトップに立った実績に裏打ちされた、同カテゴリー最大の参考予算を有しています。しかし、この手法が無視できない2つの点でタイトルを逃しています。それは、2.5固有の品質がまだ独立して測定されていないこと、そして執筆時点で公開APIがリリースされていなかったことです。 APIが公開され、独立したベンチマーク結果が明らかになった時点で、この順位は逆転する可能性がある。

専門家のおすすめ:Wan 3

Wan 3が専門家から支持を得ているのは、具体的かつ検証可能な1つの利点があるからだ。それは、1回のパスで30秒間の完全なテイクを生成するライブAPIが現在利用可能であるという点であり、スポット全体をシームレスに生成する必要があり、Seedanceのエンドポイントを待つことができないチームに適している。 この利点は、実証済みの品質ではなく、特定の機能の可用性に関するものであり、価格面でアリババ自身の測定済みモデルを上回り、リーダーボードでは未検証である点を十分に認識した上で選択すべきです。これは特定の用途に特化したツールであり、一般的な推奨事項ではありません。

結論

3つすべてが美しいデモを生成できるとしても、シーンが難しくなっても安定したパフォーマンスを維持できるものこそが、実際に難易度への対応能力が実証されたモデルです。現時点の証拠に基づけば、それはMiniMax H3です。最も派手なエンジンではありませんが、測定済みで、ダウンロード可能、呼び出し可能、そして手頃な価格です。 Seedance 2.5は、技術面においてより刺激的な動画モデルであり、APIとベンチマークが公開されればトップの座を奪う可能性もある。そのため、今週すぐに開発を始めるというよりは、今後の動向に注目すべきモデルだ。Wan 3は、誇張された仕様に埋もれた実在する実用可能な製品であり、30秒のワンテイク撮影が可能という点でのみ利用価値があり、それ以外の点については常に懐疑的な姿勢で臨むべきだ。 推奨は作業内容によって変わる:演出可能なシネマティック作品やコマーシャルの編集が主目的ならSeedanceを、検証済みの品質、キャラクター作業、短編の大量処理、あるいはライブパイプラインが主目的ならH3を、そして今日すぐに利用可能な単一のロングテイクが具体的な要件である場合にのみWan 3を選ぶべきだ。何よりも、Wan 3で4K機能に料金を支払ってはならない。そのオプションは存在しない。

Felix Rose-Collins

Felix Rose-Collins

Ranktracker's CEO/CMO & Co-founder

Felix Rose-Collins is the Co-founder and CEO/CMO of Ranktracker. With over 15 years of SEO experience, he has single-handedly scaled the Ranktracker site to over 500,000 monthly visits, with 390,000 of these stemming from organic searches each month.

Ranktrackerを無料で使いましょう。

あなたのWebサイトのランキングを妨げている原因を突き止めます。

無料アカウント作成

または認証情報を使ってサインインする

Different views of Ranktracker app