उपलब्ध एआई भिडियो क्याटलग

एआई भिडियो मोडेलहरू

भिडियो मोडेल संस्करणहरू ब्राउज गर्नुहोस् जुन वर्तमानमा उत्पादनको लागि उपलब्ध छ।

Davinci Magihuman

daVinci MagiHuman is a 15B parameter omni video generation model — the new open-source king on par with WAN 2.5. Generates high-quality AI videos from text prompts with optional audio input. Supports digital humans, talking heads, and general video generation.

wavespeed-ai/davinci-magihuman/image-to-video

image to video

उपलब्ध

wavespeed-ai/davinci-magihuman/text-to-video

text to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Pixverse V6

PixVerse V6 generates high-quality videos from images with flexible duration (1-15s), multiple resolutions up to 1080p, and optional audio generation. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

pixverse/pixverse-v6/text-to-video

text to video

उपलब्ध

pixverse/pixverse-v6/image-to-video

image to video

उपलब्ध

pixverse/pixverse-v6/transition

image to video

उपलब्ध

pixverse/pixverse-v6/reference-to-video

image to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Pixverse V5.5

PixVerse V5.5 transforms text prompts into realistic videos with smooth motion and natural detail in seconds—ideal for stories, ads, and social clips. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

pixverse/pixverse-v5.5/image-to-video

image to video

उपलब्ध

pixverse/pixverse-v5.5/text-to-video

text to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Pixverse V5.5 Transition

Create smooth morph transitions between two images into 5s , 8s or 10s videos at 360p, 540p, 720p, or 1080p—perfect for logo reveals, before-and-after shots, and social posts. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

pixverse/pixverse-v5.5-transition

image to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Pixverse V5.5 Effects

PixVerse V5.5 Effects is an AI image-to-video model that converts still images into smooth, natural short videos with lifelike motion, supporting 5s/8s/10s clips at 360p to 1080p for social posts, ads, and previews. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

pixverse/pixverse-v5.5-effects

image to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Flux 3

Text-to-image generation with FLUX.3 is Black Forest Labs' frontier video model. This endpoint generates video directly from a text prompt, translating a written description into motion, composition, and scene. .

black-forest-labs/flux-3/start-end-to-video

image to video

उपलब्ध

black-forest-labs/flux-3/image-to-video

image to video

उपलब्ध

black-forest-labs/flux-3/text-to-video

text to video

उपलब्ध

black-forest-labs/flux-3/start-end-to-video-draft

image to video

उपलब्ध

black-forest-labs/flux-3/text-to-video-draft

text to video

उपलब्ध

black-forest-labs/flux-3/image-to-video-draft

image to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Kling V2.6 Pro

Kling 2.6 Pro delivers top-tier text-to-video generation with smooth motion, cinematic visuals, strong prompt adherence, and native audio for ready-to-share clips. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

kwaivgi/kling-v2.6-pro/image-to-video

image to video

उपलब्ध

kwaivgi/kling-v2.6-pro/text-to-video

text to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Veo3.1

Google Veo3.1 Reference-to-Video performs image-to-video generation that preserves a specific subject's appearance and identity from provided reference images, enabling consistent character or product motion across frames. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

google/veo3.1/image-to-video

image to video

उपलब्ध

google/veo3.1/text-to-video

text to video

उपलब्ध

google/veo3.1/reference-to-video

image to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Kling Video O3 Pro

Kling Omni Video O3 Video-Edit enables conversational video editing through natural language commands. Remove objects, change backgrounds, modify styles, adjust weather/lighting, and transform scenes with simple text instructions like 'remove pedestrians' or 'change daytime to dusk'. Ready-to-use REST API, best performance, no coldstarts, affordable pricing.

kwaivgi/kling-video-o3-pro/image-to-video

image to video

उपलब्ध

kwaivgi/kling-video-o3-pro/reference-to-video

image to video

उपलब्ध

kwaivgi/kling-video-o3-pro/text-to-video

text to video

उपलब्ध

kwaivgi/kling-video-o3-pro/video-edit

video to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Kling Video O3 4k

Kling Omni Video O3 is Kuaishou's advanced unified multi-modal video model with MVL (Multi-modal Visual Language) technology. Text-to-Video mode generates cinematic videos from text prompts with subject consistency, natural physics simulation, and precise semantic understanding. Supports audio generation. Ready-to-use REST API, best performance, no coldstarts, affordable pricing.

kwaivgi/kling-video-o3-4k/image-to-video

image to video

उपलब्ध

kwaivgi/kling-video-o3-4k/reference-to-video

image to video

उपलब्ध

kwaivgi/kling-video-o3-4k/text-to-video

text to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Ray 3.2

Ray 3.2 Video Edit re-renders an existing source video from a text prompt while preserving the source motion and timing.

luma/ray-3.2/video-reframing

video to video

उपलब्ध

luma/ray-3.2/video-edit

video to video

उपलब्ध

luma/ray-3.2/text-to-video

text to video

उपलब्ध

luma/ray-3.2/image-to-video

image to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Kling V2.5 Turbo Pro

Kling 2.5 Turbo Pro is a Text-to-Video model that delivers cinematic visuals, fluid motion, and precise prompt-to-motion responsiveness. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

kwaivgi/kling-v2.5-turbo-pro/image-to-video

image to video

उपलब्ध

kwaivgi/kling-v2.5-turbo-pro/text-to-video

text to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Kling Video O1

Kling Omni Video O1 is Kuaishou's first unified multi-modal video model with MVL (Multi-modal Visual Language) technology. Text-to-Video mode generates cinematic videos from text prompts with subject consistency, natural physics simulation, and precise semantic understanding. Ready-to-use REST API, best performance, no coldstarts, affordable pricing.

kwaivgi/kling-video-o1/reference-to-video

image to video

उपलब्ध

kwaivgi/kling-video-o1/text-to-video

text to video

उपलब्ध

kwaivgi/kling-video-o1/video-edit-fast

video to video

उपलब्ध

kwaivgi/kling-video-o1/video-edit

video to video

उपलब्ध

kwaivgi/kling-video-o1/image-to-video

image to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Kling Video O1 Std

Kling Omni Video O1 (Standard) is Kuaishou's first unified multi-modal video model with MVL (Multi-modal Visual Language) technology. Text-to-Video mode generates cinematic videos from text prompts with subject consistency, natural physics simulation, and precise semantic understanding. Ready-to-use REST API, best performance, no coldstarts, affordable pricing.

kwaivgi/kling-video-o1-std/reference-to-video

image to video

उपलब्ध

kwaivgi/kling-video-o1-std/text-to-video

text to video

उपलब्ध

kwaivgi/kling-video-o1-std/image-to-video

image to video

उपलब्ध

kwaivgi/kling-video-o1-std/video-edit

video to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Pixverse V5.6

PixVerse V5.5 transforms text prompts into realistic videos with smooth motion and natural detail in seconds—ideal for stories, ads, and social clips. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

pixverse/pixverse-v5.6/image-to-video

image to video

उपलब्ध

pixverse/pixverse-v5.6/text-to-video

text to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Short Video Generator

WaveSpeed Short Video Generator creates professional short-form videos from text prompts and optional reference images with native audio, smooth motion, and versatile aspect ratios. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

wavespeed-ai/short-video-generator

text to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Cinematic Video Generator

WaveSpeed Cinematic Video Generator creates Hollywood-grade videos from text prompts and optional reference images with native audio, director-level camera control, and real-world physics. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

wavespeed-ai/cinematic-video-generator

text to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

V2.2 Pikaframes

Create precise keyframe-to-video sequences with Pika V2.2 Pikaframes. Upload up to 5 keyframes, set per-transition prompts and durations, and interpolate smooth motion for storyboards, camera moves, and style-consistent animation. Supports total runtimes up to 25 seconds. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

pika/v2.2-pikaframes

image to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Lucy Restyle

Lucy-Restyle is a state-of-the-art text-guided video editing model that transforms videos while preserving original motion, camera angles, and temporal consistency. Edit videos up to 10 minutes with natural language prompts. Ready-to-use REST inference API, ultra-fast processing, studio-grade quality.

decart/lucy-restyle

video to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Kandinsky5 Pro

Kandinsky 5 Pro Text-to-Video generation model. Create dynamic 5-second videos from text prompts. Supports 512P and 1024P resolutions with multiple aspect ratios. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

wavespeed-ai/kandinsky5-pro/image-to-video

image to video

उपलब्ध

wavespeed-ai/kandinsky5-pro/text-to-video

text to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Ltx 2 19b

LTX-2 is the first DiT-based audio-video foundation model that contains all core capabilities of modern video generation in one model: synchronized audio and video, high fidelity, multiple performance modes, production-ready outputs, API access, and open access.

wavespeed-ai/ltx-2-19b/image-to-video

image to video

उपलब्ध

wavespeed-ai/ltx-2-19b/text-to-video

text to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Q2 Pro

Vidu Q2 Pro Fast Start-End to Video generates smooth video transitions between start and end images with faster generation speed. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

vidu/q2-pro/image-to-video-fast

image to video

उपलब्ध

vidu/q2-pro/start-end-to-video-fast

image to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Hunyuan Video 1.5

HunyuanVideo-1.5 (t2v) is a lightweight 8.3B parameter text-to-video model that generates high-quality videos with top-tier visual quality and motion coherence. Optimized for fast inference on consumer-grade GPUs. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

wavespeed-ai/hunyuan-video-1.5/image-to-video

image to video

उपलब्ध

wavespeed-ai/hunyuan-video-1.5/text-to-video

text to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Wan 2.2

WAN 2.2 T2V 720p Ultra-Fast generates high-quality 720p videos from text prompts with unlimited output and ultra-fast throughput. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

wavespeed-ai/wan-2.2/image-to-video

image to video

उपलब्ध

wavespeed-ai/wan-2.2/video-edit

video to video

उपलब्ध

wavespeed-ai/wan-2.2/i2v-480p-ultra-fast

image to video

उपलब्ध

wavespeed-ai/wan-2.2/i2v-720p-ultra-fast

image to video

उपलब्ध

wavespeed-ai/wan-2.2/t2v-480p-ultra-fast

text to video

उपलब्ध

wavespeed-ai/wan-2.2/t2v-5b-720p

text to video

उपलब्ध

wavespeed-ai/wan-2.2/i2v-5b-720p

image to video

उपलब्ध

wavespeed-ai/wan-2.2/i2v-480p

image to video

उपलब्ध

wavespeed-ai/wan-2.2/i2v-720p

image to video

उपलब्ध

wavespeed-ai/wan-2.2/t2v-480p

text to video

उपलब्ध

wavespeed-ai/wan-2.2/t2v-720p

text to video

उपलब्ध

wavespeed-ai/wan-2.2/t2v-720p-ultra-fast

text to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Ltx 2 Pro

LTX-2 Pro is a text-to-video engine that generates synchronized audio and 1080P video from text prompts for production workflows. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

lightricks/ltx-2-pro/image-to-video

image to video

उपलब्ध

lightricks/ltx-2-pro/text-to-video

text to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Hailuo 02

Hailuo 02 is an AI video-generation model delivering 768P output with fast responsiveness and strong handling of complex physics scenes. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

minimax/hailuo-02/fast

image to video

उपलब्ध

minimax/hailuo-02/i2v-pro

image to video

उपलब्ध

minimax/hailuo-02/t2v-pro

text to video

उपलब्ध

minimax/hailuo-02/i2v-standard

image to video

उपलब्ध

minimax/hailuo-02/t2v-standard

text to video

उपलब्ध

minimax/hailuo-02/pro

image to video

उपलब्ध

minimax/hailuo-02/standard

image to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Wan 3.0

Alibaba WAN 3.0 Reference-to-Video combines reference images, videos, and audio with prompts to create coherent videos with flexible 2-30 second duration, resolution, aspect ratio, audio, and deep-thinking controls. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

alibaba/wan-3.0/text-to-video

text to video

उपलब्ध

alibaba/wan-3.0/image-to-video

image to video

उपलब्ध

alibaba/wan-3.0/reference-to-video

image to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Minimax H3

Open-weights MiniMax H3 image-to-video on WaveSpeed infrastructure: animate a first-frame image (optionally with a last frame) into a coherent 480p/768p video with native stereo audio, 5-15 second durations, and affordable per-second pricing.

wavespeed-ai/minimax-h3/reference-to-video

image to video

उपलब्ध

wavespeed-ai/minimax-h3/text-to-video

text to video

उपलब्ध

wavespeed-ai/minimax-h3/image-to-video

image to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Gemini Omni Flash

Gemini Omni Flash Text-to-Video creates short videos with synchronized audio from a text prompt.

google/gemini-omni-flash/video-edit

video to video

उपलब्ध

google/gemini-omni-flash/reference-to-video

image to video

उपलब्ध

google/gemini-omni-flash/image-to-video

image to video

उपलब्ध

google/gemini-omni-flash/text-to-video

text to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Pixverse C1

PixVerse C1 generates smooth transition videos between two images with flexible duration (1-15s), multiple resolutions up to 1080p, and optional native audio generation. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

pixverse/pixverse-c1/text-to-video

text to video

उपलब्ध

pixverse/pixverse-c1/image-to-video

image to video

उपलब्ध

pixverse/pixverse-c1/transition

image to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Kling V2.1 I2v Pro

Kling v2.1 I2V Pro Start-End Frame generates cinematic Image-to-Video clips with precise start/end frame control, enhanced visual fidelity, and dynamic camera motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

kwaivgi/kling-v2.1-i2v-pro

image to video

उपलब्ध

kwaivgi/kling-v2.1-i2v-pro/start-end-frame

image to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Wan 2.1

Wan 2.1 i2v-720p generates image-to-video outputs at 720p and supports custom LoRA adapters for personalized styles and fine-tuning. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

wavespeed-ai/wan-2.1/synthetic-to-real-ditto

video to video

उपलब्ध

wavespeed-ai/wan-2.1/ditto

video to video

उपलब्ध

wavespeed-ai/wan-2.1/mocha

video to video

उपलब्ध

wavespeed-ai/wan-2.1/t2v-720p

text to video

उपलब्ध

wavespeed-ai/wan-2.1/t2v-480p

text to video

उपलब्ध

wavespeed-ai/wan-2.1/i2v-720p

image to video

उपलब्ध

wavespeed-ai/wan-2.1/i2v-480p

image to video

उपलब्ध

wavespeed-ai/wan-2.1/v2v-720p-ultra-fast

video to video

उपलब्ध

wavespeed-ai/wan-2.1/v2v-720p

video to video

उपलब्ध

wavespeed-ai/wan-2.1/v2v-480p

video to video

उपलब्ध

wavespeed-ai/wan-2.1/v2v-480p-ultra-fast

video to video

उपलब्ध

wavespeed-ai/wan-2.1/i2v-720p-ultra-fast

image to video

उपलब्ध

wavespeed-ai/wan-2.1/i2v-480p-ultra-fast

image to video

उपलब्ध

wavespeed-ai/wan-2.1/t2v-720p-ultra-fast

text to video

उपलब्ध

wavespeed-ai/wan-2.1/t2v-480p-ultra-fast

text to video

उपलब्ध

wavespeed-ai/wan-2.1/i2v-720p-lora

image to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Cosmos Predict 2.5

Cosmos Predict 2.5 Text-to-Video generates video from text prompts using NVIDIA's 2B Cosmos Post-Trained Model. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

wavespeed-ai/cosmos-predict-2.5/image-to-video

image to video

उपलब्ध

wavespeed-ai/cosmos-predict-2.5/text-to-video

text to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Ltx 2.3

LTX-2 is the first DiT-based audio-video foundation model that contains all core capabilities of modern video generation in one model: synchronized audio and video, high fidelity, multiple performance modes, production-ready outputs, API access, and open access.

wavespeed-ai/ltx-2.3/text-to-video

text to video

उपलब्ध

wavespeed-ai/ltx-2.3/image-to-video

image to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

WAN 2.7

Text, image, and source-video generation with optional audio guidance.

alibaba/wan-2.7/text-to-video

text to video

उपलब्ध

alibaba/wan-2.7/image-to-video

image to video

उपलब्ध

alibaba/wan-2.7/video-edit

video to video

उपलब्ध

alibaba/wan-2.7/image-to-video-pro

image to video

उपलब्ध

alibaba/wan-2.7/image-to-video-spicy

image to video

उपलब्ध

alibaba/wan-2.7/reference-to-video

image to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Happy Horse 1.1

Alibaba text-to-video and image-to-video generation.

alibaba/happyhorse-1.0/image-to-video

image to video

उपलब्ध

alibaba/happyhorse-1.1/image-to-video

image to video

उपलब्ध

alibaba/happyhorse-1.1/text-to-video

text to video

उपलब्ध

alibaba/happyhorse-1.1/reference-to-video

image to video

उपलब्ध

alibaba/happyhorse-1.0/video-edit

video to video

उपलब्ध

alibaba/happyhorse-1.0/reference-to-video

image to video

उपलब्ध

alibaba/happyhorse-1.0/text-to-video

text to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Kling O3 Standard

Reference-driven generation and advanced video editing.

kwaivgi/kling-video-o3-std/image-to-video

image to video

उपलब्ध

kwaivgi/kling-video-o3-std/text-to-video

text to video

उपलब्ध

kwaivgi/kling-video-o3-std/video-edit

video to video

उपलब्ध

kwaivgi/kling-video-o3-std/reference-to-video

image to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

WAN 2.6

General-purpose text and image video generation.

alibaba/wan-2.6/image-to-video

image to video

उपलब्ध

alibaba/wan-2.6/image-to-video-spicy

image to video

उपलब्ध

alibaba/wan-2.6/reference-to-video-flash

image to video

उपलब्ध

alibaba/wan-2.6/image-to-video-flash

image to video

उपलब्ध

alibaba/wan-2.6/text-to-video

text to video

उपलब्ध

alibaba/wan-2.6/reference-to-video

image to video

उपलब्ध

alibaba/wan-2.6/image-to-video-pro

image to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Vidu Q3

High-fidelity generation with motion and music controls.

vidu/q3/image-to-video

image to video

उपलब्ध

vidu/q3/text-to-video

text to video

उपलब्ध

vidu/q3/image-to-video-pro

image to video

उपलब्ध

vidu/q3/reference-to-video

image to video

उपलब्ध

vidu/q3/start-end-to-video

image to video

उपलब्ध

vidu/q3/image-to-video-spicy

image to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्

Hailuo 2.3

Physics-aware image-to-video generation.

minimax/hailuo-2.3/i2v-standard

image to video

उपलब्ध

minimax/hailuo-2.3/fast-pro

image to video

उपलब्ध

minimax/hailuo-2.3/fast

image to video

उपलब्ध

minimax/hailuo-2.3/i2v-pro

image to video

उपलब्ध

minimax/hailuo-2.3/t2v-standard

text to video

उपलब्ध

minimax/hailuo-2.3/t2v-pro

text to video

उपलब्ध
यो मोडेलको साथ सिर्जना गर्नुहोस्