AIAPIAIAPI API

图像与视频生成 API 文档

AIAPIAIAPI 统一异步图像与视频生成 API 文档

接口

图像:POST /v1/images/generations/async

视频:POST /v1/video/generations

认证

Authorization: Bearer <AIAPIAIAPI_API_KEY>

调用流程

图像任务使用返回的 task_id 查询 GET /v1/images/generations/async/{task_id},状态为 SUCCESS 后读取 outputs。

视频任务使用返回的 id 查询 GET /v1/video/generations/{task_id},状态为 completed 后读取 outputs[0].url。

错误响应

图像接口返回 code/message/data;视频接口返回 error.type/error.code/error.message/error.param。

模型 API 文档

模型类型任务说明
alibaba/qwen-image-edit-spicyimageimage-to-image文本引导的图像编辑模型:支持添加、移除或修改元素,以及风格迁移和背景替换。
alibaba/wan-2.2-i2v-spicyvideoimage-to-video图生视频模型:需要提供首帧图片,并支持可选的首尾帧插值。
alibaba/wan-2.7-i2vvideoimage-to-video图生视频模型:可选控制结束帧;分辨率随输入图自适应,因此不能配置 aspect_ratio。
alibaba/wan-2.7-i2v-spicyvideoimage-to-video图生视频模型:根据文本提示让单张源图片动起来,并可选控制结束帧。
alibaba/wan-2.7-i2v-uncensoredvideoimage-to-video图生视频模型:参数与 wan-2.7-i2v-spicy 相同,不启用内容审核。
alibaba/wan-2.7-ref2v-uncensoredvideoreference-to-video参考生视频模型:最多支持 3 张参考图片和 3 个参考视频。
alibaba/wan-2.7-t2vvideotext-to-video文生视频模型:无需提供源图片。
alibaba/wan-3.0-i2v-spicyvideoimage-to-video图生视频模型:支持更宽的视频时长范围、更多分辨率和可配置宽高比。
alibaba/wan-3.0-prime-i2v-spicyvideoimage-to-video图生视频模型:支持更宽的视频时长范围、更多分辨率和可配置宽高比。
alibaba/wan-3.0-prime-ref2v-spicyvideoreference-to-video参考生视频模型:可使用图片、视频和音频作为参考,并可配置时长、分辨率和宽高比。
alibaba/wan-3.0-ref2v-spicyvideoreference-to-video参考生视频模型:可使用图片、视频和音频作为参考,并可配置时长、分辨率和宽高比。
alibaba/wan-3.0-videovideotext-image-reference-to-video一个端点根据请求中的媒体字段自动选择文生视频、关键帧图生视频或参考生视频;关键帧输入与参考输入不可混用。
alibaba/z-image-spicyimagetext-to-image文生图模型:支持自定义尺寸、可复现随机种子,以及可选的智能提示词改写。
alibaba/z-image-spicy-proimagetext-to-image文生图模型:支持最高 2560 像素的自定义尺寸、可复现随机种子,以及可选的提示词改写。
bytedance/seedance-2.0-i2v-spicyvideoimage-to-video图生视频模型:最高支持 4K 分辨率和包括 21:9 在内的 7 种宽高比。
bytedance/seedance-2.0-mini-i2v-spicyvideoimage-to-video图生视频模型:需要首帧图片,可选控制尾帧,支持 720p 或 1080p 分辨率及 4–15 秒输出。
bytedance/seedance-2.0-mini-ref2v-spicyvideoreference-to-video参考生视频模型:最多支持 9 张图片、3 个视频和 3 段音频,支持 720p 或 1080p 分辨率及 4–15 秒输出。
bytedance/seedance-2.0-ref2v-spicyvideoreference-to-video参考生视频模型:可使用图片、视频和音频作为参考,最高支持 4K 分辨率。
bytedance/seedance-2.5-i2v-spicyvideoimage-to-video图生视频模型:视频时长范围扩展到最长 30 秒。
bytedance/seedance-2.5-ref2v-spicyvideoreference-to-video参考生视频模型:最多支持 30 张图片、10 个视频和 10 段音频,并支持自动时长。
minimax-h3-enhanced-reference-to-videovideoreference-to-videoMiniMax 参考生视频模型:最多支持 9 张图片、9 个视频和 9 段音频,分辨率最高 4K。
minimax-h3-image-to-videovideoimage-to-videoMiniMax 图生视频模型:支持 5-15 秒输出,分辨率可选 768p 或 2K。
minimax-h3-max-image-to-videovideoimage-to-videoMiniMax H3 Max 图生视频模型:支持 5-15 秒输出,分辨率可选 480p 或 768p。
minimax-h3-max-reference-to-videovideoreference-to-video通过 Venice 使用 MiniMax H3 Max 参考生视频。模型专属的时长、分辨率及参考素材限制由上游校验。
minimax-h3-max-turbo-image-to-videovideoimage-to-video通过 Venice 使用 MiniMax H3 Max Turbo 图生视频。模型专属的时长及分辨率限制由上游校验。
minimax-h3-reference-to-videovideoreference-to-videoMiniMax 参考生视频模型:最多支持 9 张图片、9 个视频和 9 段音频,分辨率可选 768p 或 2K。
minimax/minimax-h3-i2v-spicyvideoimage-to-videoMiniMax 图生视频模型:支持 5-15 秒输出,分辨率可选 768p、2K 或 4K。
minimax/minimax-h3-ref2v-spicyvideoreference-to-videoMiniMax 参考生视频模型:最多支持 9 张图片、9 个视频和 9 段音频,分辨率最高 4K。
openai/gpt-image-2.5-flare/editimageimage-to-image支持 1 至 16 张参考图片、可选蒙版和透明背景输出的图像编辑模型。
openai/gpt-image-2.5-flare/text-to-imageimagetext-to-image支持自定义尺寸、多档质量和透明背景的文生图模型。
openai/gpt-image-2.5-sunburst/editimageimage-to-image支持 1 至 16 张参考图片、可选蒙版和透明背景输出的图像编辑模型。
openai/gpt-image-2.5-sunburst/text-to-imageimagetext-to-image支持自定义尺寸、多档质量和透明背景的文生图模型。
wan-3-0-prime-image-to-videovideoimage-to-video图生视频模型:支持更宽的视频时长范围、更多分辨率和可配置宽高比。
wan-3-0-prime-reference-to-videovideoreference-to-video参考生视频模型:可使用图片、视频和音频作为参考,并可配置时长、分辨率和宽高比。

文档索引

获取完整文档索引:

https://aiapiaiapi.com/llms.txt

使用该文件发现所有可用的 API 文档。