テキストからビデオへ

2025年のテキストからビデオへのAIツールは、テキストを高品質なビデオに自動変換し、視覚コンテンツ制作を革新しています。マーケティングや出版、eコマースで広く活用され、生産性と魅力を大幅に向上させ、クリエイターに新たな可能性を提供します。
  • AIforASMR
    テキストプロンプト、参考画像、サウンドテンプレートから、睡眠、ウェルネス、商品、SNS向けの心地よいASMR動画を作成します。
    0
    0
    AIforASMRとは?
    AIforASMRは、テキスト、画像、参考入力から心地よいASMR動画のドラフトを生成するための専用ワークスペースを提供します。ユーザーはまずサウンドまたはシーンのテンプレートを選び、質感、照明、カメラの動き、テンポ、雰囲気を記述します。45以上のテンプレートが、自然、環境音、口の音、触感、飲食物、日用品、楽器、書く動作、水、木をカバーします。画像ガイダンスは商品・物体・スタイルの一貫性を支え、テキストのみの生成は素早い探索に適しています。ユーザーは結果をプレビューし、プロンプトやモデル設定を調整し、やさしくループ可能な動きへと反復できます。出力例には、窓に当たる雨、海の波、焚き火、スキンケアのクローズアップ、指先のタッピング、紙のこすれる音、キャンドルライト、水の流れ、木彫りのシーンが含まれます。
  • TryH3
    プロンプトや画像から、同期ステレオサウンドと6種類のアスペクト比を備えた、ネイティブ2Kの4〜15秒動画を作成できます。
    0
    0
    TryH3とは?
    TryH3はMiniMax H3を使って短い動画を生成する、ブラウザベースのワークフローを提供します。ユーザーはテキストプロンプトから始めたり、最初のフレームをアップロードしたり、開始フレームと終了フレームの両方を指定したり、画像・動画・音声を含むマルチモーダル参照を提供したりできます。ジェネレーターは4〜15秒のネイティブ2Kクリップを生成し、同期された環境音と効果音を含みます。6種類のアスペクト比は、ワイドスクリーン、正方形、縦長、その他の制作フォーマットに対応します: 16:9、9:16、1:1、4:3、3:4、21:9。参照入力は、ショット間でキャラクターの顔、服装、視覚スタイルを維持するのに役立ちます。ユーザーは長さを選択し、ブラウザで結果をプレビューし、MP4ファイルをダウンロードし、ショーケース例のプロンプトを再利用できます。有料サブスクリプションには商用利用権が含まれ、失敗したジョブは自動的に返金されます。
  • MiniMax H3 AI
    テキスト、画像、動画、音声を組み合わせ、同期したステレオサウンド付きで、最大 15 秒の一貫したネイティブ 2K 動画を作成します。
    0
    0
    MiniMax H3 AIとは?
    MiniMax H3 はブラウザベースのマルチモーダル動画制作プラットフォームです。文章プロンプト、最初または最後のフレーム画像、動画クリップ、音声クリップ、またはこれらの組み合わせから動画を生成します。ユーザーは、複数ショットの流れ、カメラの動き、トランジション、ライティング、会話、音楽、効果音、環境音を 1 つの短い指示で表現できます。プラットフォームは、24 FPS のネイティブ 2K 出力、最大 15 秒の尺、ステレオ音声、シネマ、横長、正方形、縦長フォーマットに対応します。参照として最大 9 枚の画像、3 本の動画クリップ、3 本の音声クリップを使用できます。指示ベースの編集により、選択した要素を保持しながら、既存クリップの一部を差し替え、再照明し、再演出し、書き換えることができます。無料登録クレジットがあり、商用利用権と透かしなし出力を備えた有料月額プランおよび従量課金クレジットも利用できます。
  • Seedance 2.5 AI Video
    プロンプトと最大50件のマルチモーダル参照から30秒のAI動画クリップを生成し、ローカルな詳細を調整します。
    0
    0
    Seedance 2.5 AI Videoとは?
    JXPのSeedance 2.5ワークスペースは、プロンプトとマルチモーダル参照から、より長いAI動画ドラフトを作成します。ユーザーは、画像、動画、音声、3D white-model blockoutsを含む最大50件の素材をアップロードして、被写体、製品、環境、動き、音、スタイルを指示できます。ネイティブの単一セグメント出力は、つなぎ合わせなしで30秒に達します。作成パネルでは、解像度、アスペクト比、長さ、モデルのコントロールを提供し、480pと720pのオプションや、16:9、9:16、1:1などの形式を利用できます。生成後は、シーン全体を再生成せずに、選択したオブジェクト、領域、または詳細をローカル編集で変更できます。サービスには無料トライアルが含まれますが、より長く高解像度の生成にはアップグレードされたアカウントが必要です。実在の人間の顔、著作権で保護されたコンテンツ、暴力的コンテンツ、NSFWコンテンツは拒否されます。
  • Wan 3.0 AI Video
    プロンプト、画像、参照クリップを、演出されたカメラワークと失敗レンダーの自動返金付きで、一貫性のあるシネマティック動画に変換します。
    0
    0
    Wan 3.0 AI Videoとは?
    Wan 3.0 は、テキスト、画像、参照映像から短いクリップを作成するブラウザベースの動画生成プラットフォームです。静止画像に動き、物理演算、カメラ移動、映画的なテンポを加えてアニメーション化したり、シーンを記述してテキストから動画を生成したりできます。ワークフローは、開始フレームと終了フレーム、マルチショットシーケンス、参照クリップ、製品画像、ペアフレームに対応しています。16:9、720P、5秒動画の生成を目標としており、アクション、ムード、トランジション、テンポ、カメラ方向のコントロールを提供します。プラットフォームはクリップ全体でキャラクター、製品、スタイルの一貫性を重視しています。ユーザーはクレジット費用を事前に確認し、プロンプトを改善し、有料プランではウォーターマークなしで書き出しをダウンロードでき、レンダー失敗時にはクレジットが自動返金されます。クレジットは Wan 3.0、Veo、その他の利用可能なモデル間で共有されます。
  • Video Gen Now
    テキストプロンプトや静止画像から、そのまま投稿できる MP4 クリップを作成。選択可能なモデル、アスペクト比、約1分のレンダリングに対応します。
    0
    0
    Video Gen Nowとは?
    Video Gen Now は、1つのプロンプトボックスからテキストから動画、画像から動画への生成を提供します。ユーザーはカメラの動き、照明、テンポ、シーンを記述したり、パックショットや静止フレームをアップロードしてアニメーション化できます。各ショットごとに複数の動画モデルを選択でき、送信前に必要クレジットが表示されます。プラットフォームは、縦長、正方形、横長、さらに 480p から 4K までの解像度を含む複数の出力形式に対応し、MP4 で書き出せます。各レンダリングは元のプロンプトの横に保存され、ユーザーはショットを分岐・修正できます。共有ライブラリが生成クリップを整理します。Creator プランでは画像から動画、透かしなし、商用ライセンス、優先レンダリングが追加され、Studio では API アクセス、同時レンダリング、優先サポートが追加されます。
  • Wan 3.0
    テキスト、画像、クリップ、音声からつながった AI 動画シーケンスを作成し、ショット、カメラワーク、テンポ、サウンドを演出します。
    0
    0
    Wan 3.0とは?
    Wan 3 は、AI 動画を生成・構成するための動画中心のワークスペースです。ユーザーはテキスト、画像、参照メディアから始め、被写体、アクション、設定、カメラワーク、照明、テンポ、サウンドを定義できます。Studio は、キャラクター画像、製品写真、スタイルフレーム、動画クリップ、音声、以前の生成結果を創作のアンカーとして受け入れます。マルチショットのワークフローは、選択したキャラクター、製品、配色、素材、視覚言語を保ちながら、冒頭、動作、転換、結末をつなぎます。ユーザーは別案のショットを比較し、連続性の問題を修正し、選んだクリップをシーケンスとして並べられます。対応ワークフローでは横長、縦長、正方形の形式が使え、利用可能な場合は音声生成や演出にも対応します。Wan 3 は、製品映像、SNS ストーリー、キャンペーン企画、プレゼンテーション、動く絵コンテ向けに設計されています。
  • Minimax H3
    ネイティブ音声付きの 4〜15 秒 2K クリップを生成し、ポイント指定で変更できるマルチモーダル AI 動画ジェネレーター。
    0
    0
    Minimax H3とは?
    MiniMax H3 は、4〜15 秒のクリップ、2K 出力、複合参照入力、精密編集という 4 つを中心に構築された汎用マルチモーダル動画モデルです。 画像、動画、音声は 1 回のリクエストにまとめて入力します。H3 は各参照内のキャラクター、動き、感情、カメラ言語、スタイル、創作意図を読み取り、後で自分で組み立てる必要のある生素材ではなく、ひとつの一貫した映像音声シーンとして融合します。 編集はこのモデルのもう半分です。キャラクター、オブジェクト、シーン、音、あるいはテンポそのものを指し示すと、H3 は詳細な指示に従ってその部分だけを正確に変更し、他の要素はすべて維持します。つまり、ショット全体を作り直すのではなく、既存の映像を反復改善していくことができます。 この組み合わせは、広告、ブランド映像、Eコマース、短編ドラマ、ゲームコンテンツなど、実際の商用制作に適しています。H3 は字幕、ブランドマーク、UI 要素を後付けではなくデザインの一部として構成するため、他のモデルに対して最も強みを発揮します。
  • ImagetoVideo AI
    プロンプト、商品写真、キーフレームから短い動画を作成し、モーション、長さ、解像度、アスペクト比、音声を調整できます。
    0
    0
    ImagetoVideo AIとは?
    Image To Video AI は、テキスト、参照画像、またはキーフレームから動画を生成するブラウザベースのワークスペースを提供します。ユーザーは被写体、アクション、カメラの動き、照明、雰囲気、スタイル、テンポを記述し、適切な動画モデルを選択できます。利用できるコントロールには、モデルのバリエーション、生成モード、短いクリップから最大 15 秒までの長さ、480p や 720p などの解像度オプション、縦型やワイドスクリーン形式を含むアスペクト比、そして音声生成が含まれる場合があります。参照画像には、商品写真、ポートレート、イラスト、図表、キャンペーン用ビジュアルなどを使用できます。生成結果は自動的に Library に保存され、再生、確認、開く、ダウンロードが可能です。このプラットフォームは、商品広告、SNS 用短尺動画、レッスン解説、店舗用素材、ローンチ動画、クリエイティブ方向性のテストをサポートします。
  • シーダンス
    日本語プロンプトや静止画像から、3〜15秒の広告・SNS動画を音声付きで作成できます。
    0
    0
    シーダンスとは?
    Seedance 2 は、短尺コンテンツ向けにブラウザベースのテキスト-to-動画および画像-to-動画生成を提供します。テキストプロンプトでは、製品、都市環境、キャラクター、カメラの動き、ライティング、アクションなどのシーンを記述できます。アップロードした静止画像には、動き、雰囲気、カメラプレッシャー、広告風の演出を加えてアニメーション化でき、終了画像を定義することも可能です。生成は3〜15秒のクリップに対応し、標準の480p出力に加えて、720pまたは1080pを選択できます。対応構成では、動画とともにサウンドや会話を含むネイティブ音声を生成できます。サービスは Seedance 2 Mini の登録クレジットによる無料トライアルを提供しており、有料プランでは追加のモデル、クレジット、制作 क्षमताが利用できます。クレジット消費は、長さ、モード、音声、モデルによって異なります。
  • Seedance AI Video Generator
    テキスト、画像、動画、音声から、リアルな動き、カスタマイズ可能な形式、毎日の無料生成付きで映画のような動画を作成できます。
    0
    0
    Seedance AI Video Generatorとは?
    Seedance AI は、テキストプロンプト、参照画像、既存の動画、または音声から短い動画を作成するためのWebベースの動画ジェネレーターです。マルチモーダルなワークフローにより、画像から動画、テキストから動画、参照ベースの作成をサポートします。ユーザーはモデルを選択し、最大12件のメディアをアップロードし、長さ、品質、アスペクト比を選び、480P、720P、1080Pで動画を生成できます。このツールは、カメラ移動、リアルなキャラクターアニメーション、表情豊かな顔の動き、同期された音声を備えた映画的なシーン向けに設計されています。また、製品紹介、eコマース広告、バーチャルプレゼンター、ソーシャルクリップ、ストーリー案、顔出しなし動画もサポートします。毎日の無料生成とログイン不要のアクセスにより、大きなプロジェクトを作成する前にアイデアを試せます。
  • Seed Imagine AI Video
    テキストプロンプトや参照画像から、編集、アニメーション、調整可能な出力設定付きの洗練された画像と短い動画を作成します。
    0
    0
    Seed Imagine AI Videoとは?
    Seed Imagineは、画像生成、動画生成、編集をブラウザベースのクリエイティブワークスペースで組み合わせます。ユーザーはプロンプトを書いたり参照画像をアップロードしたりして、商品写真、イラスト、コンセプトアート、キャラクターデザイン、シネマティックなシーンを作成できます。テキストから動画では説明文から短いクリップを作成し、画像から動画ではモーション指示と動画設定を使って静止画像をアニメーション化します。画像編集では、スタイル変更、オブジェクト削除、背景拡張、要素の結合、バリエーション作成に対応します。このプラットフォームは複数の画像・動画モデルを提供し、品質、速度、スタイル、クレジットコストを比較できます。柔軟な制御には、アスペクト比、解像度、動画の長さ、参照入力が含まれます。追加ツールとして、背景除去、ウォーターマーク除去、画像アップスケーリング、写真復元、カラー化、バッチ処理があります。結果は画像または動画として調整・ダウンロードできます。
  • Wan 3
    テキスト、画像、音声、既存クリップから、動きと音が同期した透かしなし4K動画を生成します。
    0
    0
    Wan 3とは?
    Wan 3.0 AIは、テキストから動画、画像から動画、参照から動画、動画編集のワークフローを提供するブラウザベースの動画生成プラットフォームです。ユーザーはシーンやカメラの動きを説明し、開始フレームまたは終了フレームをアップロードし、最大9枚の参照画像を提供するか、音声条件付き生成のために公開アクセス可能なMP3またはWAVのURLを追加できます。プラットフォームは最大30秒のクリップを作成し、16:9、9:16、1:1のアスペクト比に対応し、透かしなしのMP4ファイルとして出力します。機能には、ネイティブ音声生成、口パク同期、キャラクターと音声の参照融合、最初と最後のフレーム制御、自然言語による編集が含まれます。Agentインターフェースにより、パラメータを手動で調整することなく、会話形式での動画制作と反復的なスタイル調整が可能です。生成されたプロジェクトはユーザーアカウントに保存され、再閲覧、リミックス、共有ができます。
  • Flux 3 AI - Image and Video Generator
    画像を生成・編集し、参照をネイティブ音声、多言語ダイアログ、最大20秒のクリップ付き動画へ変換できます。
    0
    0
    Flux 3 AI - Image and Video Generatorとは?
    Flux 3 AI は、画像と動画制作のための統合ワークスペースを提供します。画像モードでは、詳細なプロンプトから写真風、イラスト風、シネマ風、グラフィック、実験的なビジュアルを生成でき、画像編集ではアップロードした参照を使って被写体、スタイル、レイアウト、変換を指示します。動画モードは、text-to-video、image-to-video、video-to-video、continuation、キーフレーム駆動のモーションに対応します。利用者は、動き、ダイアログ、雰囲気、イベント連動サウンドを指示でき、利用可能な場合は最大20秒のクリップを作成できます。このツールは、最大4Kまでの品質設定、複数のアスペクト比、出力数量設定、JPEG、PNG、WEBP形式で最大24MBの画像アップロードを提供します。生成した画像は、開始フレーム、モーション参照、または長い連続シーケンスの一部として使えます。
  • Flux 3
    プロンプト、画像、または参照クリップから、アスペクト比、長さ、解像度を調整できる短いシネマティック動画を作成します。
    0
    0
    Flux 3とは?
    Flux 3は、自然言語プロンプト、静止画像、参照動画から短いクリップを作成するWeb AI動画生成ツールです。ユーザーは被写体、アクション、カメラの動き、ライティング、ムード、タイミングを含めてシーンを記述し、アスペクト比、長さ、480pまたは720pの出力を選択します。画像および動画の参照は、アイデンティティ、商品の形状、構図、モーションのリズム、フレーミング、スタイルをガイドできます。このプラットフォームは、プロンプト優先の作成、動画と同時に生成されるネイティブ音声、表現豊かな動き、表情、多言語ダイアログを重視しています。また、インスピレーション用の例、課金レンダリング前のプレビュー、クレジットプラン、サインイン済みユーザー向けの生成履歴、完成クリップのダウンロードも提供します。
  • Open HappyHorse
    強力なプロンプト忠実度とモーション制御を備えた、シネマティックなテキストから動画・画像から動画制作向けAI動画生成ツール。
    0
    0
    Open HappyHorseとは?
    HappyHorseは、テキストプロンプト、参照画像、音声からシネマティックな短尺動画を生成するために構築されたAI動画制作プラットフォームです。プロンプト忠実度、リアルな人間の動き、被写体の継続性、制御されたカメラ移動を重視しています。プラットフォームにはテキストから動画、画像から動画、リップシンク、AIアバター生成、Bullet Time や Splash Splash のような写真ベースのエフェクトが含まれます。マーケティング、ストーリーテリング、解説動画、ソーシャルコンテンツ向けに、迅速で制作向きの動画出力を必要とするクリエイターやチーム向けに設計されています。さらに、より一貫した結果のために多言語プロンプトとワークフロー反復をサポートします。
  • Happyhorse-1.0 API
    ネイティブ音声、リップシンク、1080p出力を備えたAI動画生成モデル。多言語コンテンツ制作に対応。
    0
    0
    Happyhorse-1.0 APIとは?
    HappyHorse 1.0 は、放送品質の動画をネイティブ音声付きで生成するよう設計されたマルチモーダルAI動画生成モデルです。1回の順方向処理で1080p出力を生成し、音声と口の動きをサブピクセル精度で一致させます。このモデルはテキストから動画、画像から動画の生成をサポートしており、広告、説明動画、予告編、ローカライズコンテンツに役立ちます。また、英語、中国語普通話、広東語、日本語、韓国語、ドイツ語、フランス語の7言語でリップシンクに対応しています。内蔵の音声合成により、別途TTSやポストプロダクションでの音声結合が不要になり、より高速で統合されたワークフローを実現します。
  • Seedance V2
    Seedance 2 はテキスト、画像、動画を参照ベースの制御で映画のような短編映像に変換します。
    0
    0
    Seedance V2とは?
    Seedance 2 はテキスト→動画、画像→動画、動画→動画のモードを提供する AI 駆動のマルチモーダル動画生成プラットフォームです。ユーザーはプロンプトとともに参照画像やクリップを提供してスタイル、キャラクター、カメラの動きを固定します。モデルは同期されたオーディオ合成、複数言語のリップシンクサポート、および短いクリップの延長オプションを備えた高精細 MP4 出力(最大 1080p、最大 24fps)を生成します。クレジットまたはサブスクリプションベースのプランで迅速な反復を想定して設計されており、広告、ソーシャル、プリビジュアライゼーション向けに制御された一貫性のある短尺の映画資産を必要とするクリエイターを対象としています。
  • Story Diffusion
    無料でオンラインでAIを利用して一貫した漫画ストーリーを作成します。
    0
    0
    Story Diffusionとは?
    ストーリーディフュージョンは、AI技術を使用してユーザーが一貫した漫画ストーリーを生成できる革新的なプラットフォームです。ユーザーは、シンプルで直感的なプロセスを通じてオンラインでユニークな漫画シリーズを作成できます。このプラットフォームは、物語の語り手やアーティストが彼らのビジョンを形にするのを助けるように設計されており、一貫性と高品質を保証するためのさまざまなツールを提供します。プロのアーティスト、アマチュアのストーリーテラー、創造的な側面を探求したい人など、ストーリーディフュージョンは魅力的で引き込まれる漫画ストーリーを作成するために必要なリソースを提供します。
  • Wan 2.7 AI
    テキスト、画像、音声サンプルを映画品質の1080P動画に変換するAI動画生成ツールです。
    0
    0
    Wan 2.7 AIとは?
    Wan 2.7 AI は、高い制御性と制作向けの動画作成のために構築されたAI動画生成プラットフォームです。テキストから動画、画像から動画、動画の再生成、開始・終了フレーム制御、マルチ画像合成、音声クローン、自然言語編集をサポートします。ネイティブ音声同期と安定したキャラクター一貫性を備えた映画品質の1080P動画の提供を目指しています。撮影、再撮影、高度な編集スキルがなくても、生成・調整・書き出しまで行えます。高速な出力、ブランドストーリー、SNS広告、製品デモ、ローカライズコンテンツ、拡張可能な動画ワークフローを必要とするクリエイター向けに位置づけられています。
フィーチャー

テキストからビデオへ

2026年のテキストからビデオへツール337を探求