by sawyer-shi · v0.0.4
TongYi AIGC: Supports full-featured image and video generation using the latest Alibaba Tongyi models (HappyHorse1.1, wan2.7, qwen-image2.0, Z-image, wan2.6,wan2.5, wan2.2, and wanx2.1).
This community listing does not yet include every recommended support, privacy, pricing, and permission disclosure. Review the available package permissions before installing.
Available inside your emploidai workspace after installation.
Available inside your emploidai workspace after installation.
A powerful Dify plugin providing comprehensive AI-powered image and video generation capabilities using Alibaba Cloud Tongyi's latest Wanxiang, Qwen, and Z-Image models. Supports text-to-image, text-to-video, image-to-image, image-to-video, image translation, and more with professional-grade quality and flexible configuration options.
resolution + ratio parameters for wan2.7 modelsGenerate images from text descriptions using Wanxiang models.
Generate images from text and reference images using Wanxiang models.
Generate images using Qwen image models.
Generate images from text and reference images using Qwen models.
Generate images using Z-Image Turbo model.
Translate text in images with AI-powered OCR and translation.
Generate videos from text descriptions using Wanxiang models.
resolution + ratio (wan2.7) or size (wan2.6 and earlier)Generate video from a single image with text description.
Generate video from first and last frame images.
Generate videos based on reference video style.
Continue a video from an existing first clip.
first_clip and first_clip + last_frameQuery the status and results of video generation tasks.
Query image translation task status and results.
Install the required dependencies:
pip install -r requirements.txt
Configure your Alibaba Cloud API credentials in the plugin settings:
Install the plugin in your Dify environment
Generate images from text descriptions.
model: Model version (default: wan2.7-image-pro)prompt: Text description of the image (required, wan2.7 <=5000 chars, wan2.6 <=2100 chars)negative_prompt: Describe what you don't want (<=500 chars, wan2.6 compatibility)size: Image size (default: 2K, supports 1K/2K/4K or specific resolutions like 1024*1024)n: Number of images to generate (1-4, up to 12 with wan2.7 sequential mode)enable_sequential: Enable grouped image generation for wan2.7 (default: false)thinking_mode: Enable thinking mode for enhanced reasoning on wan2.7 (default: true)prompt_extend: Enable prompt intelligent rewriting (default: true)watermark: Enable/disable watermark (default: true)seed: Random seed for reproducibilityGenerate images from text and reference images.
model: Model version (default: wan2.7-image-pro)prompt: Text description (required, <=5000 chars)images: Reference image files (1-9 images, required)size: Image size (default: 2K)n: Number of images to generate (1-4, up to 12 when enable_sequential=true on wan2.7)enable_sequential: Enable grouped image generation for wan2.7 (default: false)enable_interleave: Enable interleaved output (default: false)prompt_extend: Enable prompt intelligent rewriting (default: true)watermark: Enable/disable watermark (default: true)Generate images using Qwen models.
prompt: Text description (required)model: Model version (default: qwen-image-2.0-pro)size: Image size (default: 1664*928)negative_prompt: Describe what you don't wantprompt_extend: Enable prompt intelligent rewritingwatermark: Enable/disable watermark (default: true)seed: Random seed for reproducibilityGenerate images from text and reference images using Qwen models.
prompt: Text description (required)images: Reference image files (1-3 images, required)model: Model version (default: qwen-image-2.0-pro)size: Image size (default: 1024*1024)n: Number of images to generate (1-6, default: 3)prompt_extend: Enable prompt intelligent rewritingwatermark: Enable/disable watermark (default: true)Generate images using Z-Image Turbo.
prompt: Text description (required, <=800 chars)model: Model version (default: z-image-turbo)size: Image size (default: 1024*1536)prompt_extend: Enable prompt intelligent rewriting (default: false)seed: Random seed for reproducibilityTranslate text in images.
image_url: Image URL for translation (required)target_lang: Target language (required)source_lang: Source language (default: auto)domain_hint: Domain hint for improved translationsensitives: Sensitive words (JSON array)terminologies: Terminologies (JSON array)model: Model version (default: qwen-mt-image)Generate videos from text descriptions.
model: Model version (default: wan2.6-t2v)prompt: Text description (required)negative_prompt: Describe what you don't wantsize: Video resolution (default: 1920*1080)duration: Duration in seconds (model dependent, default: 5)audio_url: Custom audio file URLaudio: Auto generate audio (default: true)shot_type: Single or multi shot (default: single)prompt_extend: Enable prompt intelligent rewriting (default: true)watermark: Enable/disable watermark (default: true)seed: Random seed for reproducibilityGenerate video from an image or continue from a video clip.
model: Model version (default: wan2.6-i2v, supports wan2.7-i2v)prompt: Text descriptionimage_input / img_url: First frame image inputlast_frame_input / last_frame_url: Optional last frame image (wan2.7-i2v)first_clip_url: Optional first clip video URL for continuation (wan2.7-i2v)resolution: Video resolution (default: 1080P)duration: Duration in seconds (model dependent, default: 5)template: Video effect templateaudio_url: Custom audio file URL (wan2.7-i2v only in first-frame modes)audio: Auto generate audio (default: true)shot_type: Single or multi shot (default: single)prompt_extend: Enable prompt intelligent rewriting (default: true)watermark: Enable/disable watermark (default: true)Generate video from first and last frame images.
model: Model version (default: wan2.2-kf2v-flash)prompt: Text descriptionfirst_frame_image: First frame image (required)last_frame_image: Last frame imageresolution: Video resolution (default: 720P)template: Video effect templateprompt_extend: Enable prompt intelligent rewriting (default: true)watermark: Enable/disable watermark (default: true)Generate videos based on reference video style.
model: Model version (default: wan2.7-r2v)prompt: Text description (required, wan2.7 max 5000 / wan2.6 max 1500)reference_urls: Reference URLs (videos or images, semicolon-separated, max 5)first_frame_image: Optional first frame image URL (wan2.7-r2v)reference_voice: Optional reference voice URL (wan2.7-r2v)size: Legacy resolution in width*height (wan2.6; also mapped for wan2.7 compatibility)resolution / ratio: Native wan2.7 resolution tier and aspect ratioduration: Duration in seconds (wan2.6: 2-10; wan2.7: 2-10 or up to 15 without reference video)shot_type: Single or multi shot (wan2.6)audio: Auto generate audio (default: true, wan2.6-r2v-flash only)prompt_extend: Enable prompt intelligent rewriting (default: true)watermark: Enable/disable watermark (default: true)Query video generation task status.
task_id: Video generation task ID (required)download_video: Download video when available (default: false)Query image translation task status.
task_id: Translation task ID (required)Generate videos from text using HappyHorse model.
model: Model version (default: happyhorse-1.0-t2v)prompt: Text description for video generation (required)resolution: Video resolution - 720P or 1080P (default: 1080P)ratio: Aspect ratio - 16:9, 9:16, 1:1, 4:3, 3:4 (default: 16:9)duration: Video duration in seconds, range [3, 15] (default: 5)watermark: Enable/disable watermark (default: true)seed: Random seed for reproducibilityGenerate videos from images using HappyHorse model.
model: Model version (default: happyhorse-1.0-i2v)prompt: Text description for video generation (optional)image_input: First frame image file (optional)resolution: Video resolution - 720P or 1080P (default: 1080P)duration: Video duration in seconds, range [3, 15] (default: 5)watermark: Enable/disable watermark (default: true)seed: Random seed for reproducibilityGenerate videos from multiple reference images using HappyHorse model.
model: Model version (default: happyhorse-1.0-r2v)prompt: Text description for video generation (required)files: Reference image files (1-9 images, required)resolution: Video resolution - 720P or 1080P (default: 1080P)ratio: Aspect ratio - 16:9, 9:16, 3:4, 4:3, 1:1 (default: 16:9)duration: Video duration in seconds, range [3, 15] (default: 5)watermark: Enable/disable watermark (default: true)seed: Random seed for reproducibilityEdit videos using HappyHorse model with optional reference images.
model: Model version (default: happyhorse-1.0-video-edit)prompt: Editing instruction for the video (required)video_url: Public URL of the input video (required)files: Optional reference image files (1-5 images)resolution: Video resolution - 720P or 1080P (default: 1080P)watermark: Enable/disable watermark (default: true)audio_setting: Audio handling mode - auto or origin (default: auto)seed: Random seed for reproducibilityContinue videos from first clip using wan2.7-i2v model.
model: Model version (default: wan2.7-i2v)prompt: Describe how the video should continue (optional, max 5000 chars)negative_prompt: Describe what should not appear (optional, max 500 chars)first_clip_input: First clip file (mp4/mov, 2-10s recommended)first_clip_url: First clip URL (http/https/oss)last_frame_input: Last frame image file (optional)last_frame_url: Last frame image URL (optional)resolution: Video resolution (default: 1080P)duration: Video duration in seconds, range [2, 15] (default: 5)watermark: Enable/disable watermark (default: true)seed: Random seed for reproducibilityhttps://github.com/sawyer-shihttps://github.com/sawyer-shi/dify-plugins-tongyi_aigcThis project is licensed under Apache License 2.0. See LICENSE file for full license text.
Ready to create stunning images and videos with AI?