Skip to main content

HappyHorse 接口格式 图生视频

视频接口用于根据参考图生成视频,可选参考模式为基于首尾帧基于首帧参考图生成视频。

项目说明
请求方法POST
接口地址https://api.taiha.cn/v1/video/generations
鉴权请求头 Authorization: Bearer
Model ID模型广场对应模型详情中查看

图生视频模型

图生视频模型接受多模态输入(文本/图像/音频/视频),支持首帧生视频首尾帧生视频视频续写(首视频片段续写/首视频片段+尾帧续写)三大任务。

  • 基础设置:支持整数级视频时长(2~15 秒)、指定视频分辨率(720P/1080P)、智能改写prompt、添加水印。
  • 音频能力:支持自动配音或上传音频,实现声画同步。
  • 多镜头叙事:可生成包含多个镜头的视频,镜头切换时保持主体一致。

模型能力

支持模型:所有模型。
功能介绍:根据首帧、尾帧、视频续写,生成平滑过渡的视频。

如何输入素材:

  • 素材数量:1张首帧图像,1张尾帧图像,或1个视频。
  • 输入方式:素材URL、Base64 编码字符串。
  • 方式一:素材URL,支持 HTTP 或 HTTPS 协议。示例:https://xxxx/xxx.png。
  • 方式二:Base64 编码,仅为图像输入可选,示例:data:image/png;base64,iVBORw0KGgoAAAANSUhEUgAABDg......(示例已截断,仅做演示)。

实现声画同步

支持模型wan2.6-i2v-flashwan2.2系列模型wanx2.1系列模型
功能介绍:适用于无需音频的纯视觉展示场景,如动态海报、无声短视频等。

参数设置

  • wan2.6-i2v-flash:默认生成有声视频。若需生成无声视频,必须显式设置 audio=false。即使传入 audio_url,只要 audio=false,输出仍为无声视频,并按无声视频计费。
  • wan2.2及以下版本模型:默认生成无声视频,无需额外配置。

请求示例

POST /v1/video/generations
curl -X POST 'https://api.taiha.cn/v1/video/generations' \
-H 'Authorization: Bearer <API Key>' \
-H 'Content-Type: application/json' \
-d '{
"model": "<Model ID>",
"input" : {
"prompt": "面包师端上刷好的面包,将刷子放到一旁,镜头跟随面包师,去斜后方的烤炉进行烤制,面包师关上烤炉门,他站在烤炉旁边,看着正在烤炉里的面包,闻了闻面包的香气,说:so good。",
"media": [
{
"type": "first_clip",
"url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20260414/rptnhd/wan2.7-i2v-video-continuation-2.mp4"
}
]
},
"parameters": {
"resolution": "720P",
"ratio": "16:9",
"prompt_extend": true,
"watermark": true,
"duration": 15
}
}'

如何输入素材

// 组合一:首帧,自动配音
{
"media": [{
"type": "first_frame",
"url": "https://example.com/image.jpg"
}]
}

// 组合二:首帧+驱动音频,自定义音频
{
"media": [{
"type": "first_frame",
"url": "https://example.com/image.jpg"
}, {
"type": "driving_audio",
"url": "https://example.com/audio.mp3"
}]
}
note

请求后并不会立即返回生成内容,耗时取决于prompt复杂程度及分辨率等要求,通常需要100秒左右。您可以通过任务查询接口获取生成进度及结果。

参数说明

model  string 必填 | 模型ID

  • 模型ID,请按照模型广场中模型所示名称填写,区分大小写。
  • 您也可以通过请求端点models来获得所有可请求的模型列表。

input  array 必填 | 输入内容

prompt  string 必填 | 提示词

描述需要生成的视频内容具体要求

media  array 可选 | 输入素材

可根据以下格式,输入模型在创作时的参考素材

type  string 必填 | 素材类型

  • first_frame :视频首帧参考图像
  • last_frame :视频尾帧参考图像
  • first_clip :控制模型根据视频进行续写
  • driving_audio :控制模型依据音频驱动视频生成。

url  string 必填 | 素材URL

可输入公网URL,当素材为图像类型时,也可选择进行Base64编码

parameters  array 必填 | 生成要求

resolution  string 可选 | 分辨率

可要求视频的分辨率,如:480P/720P/1080P,模型支持的分辨率可查看具体文档

ratio  string 可选 | 画面比例

可要求视频的画面比例,如:16:9,模型支持的比例可查看具体文档

prompt_extend  boolean 可选 | 提示词优化

默认不开启,开启后模型会先对提示词进行优化,该操作会增加生成时长月3-5秒,对于提示词比较具体的请求不建议开启

watermark  boolean 可选 | 水印

默认开启,开启后生成的视频会出现AI生成的提示水印

duration  integer 必填 | 视频时长

控制视频生成的时长,以秒为单位,模型支持的最大生成时长可查看具体文档

shot_type  string 选填 | 镜头

通过multi可控制生成多镜头视频,注意官方不推荐使用该参数,如需控制多镜头,可在提示词中描述“生成单镜头视频


返回格式

{
"id" : "task_YvS3Wuau3aYnhJZYcaFwNlLd8NqkUIeo",
"task_id" : "task_YvS3Wuau3aYnhJZYcaFwNlLd8NqkUIeo",
"object" : "video",
"model" : "happyhorse-1.1-i2v",
"status" : "queued",
"progress" : 0,
"created_at" : 1785161936
}

查询结果

步骤1:创建任务获取任务ID

通过接口返回参数中的task_id获得任务ID进行查询

步骤2:根据任务ID获取结果

TASK_ID完整替换为上一步接口返回的task_id的值。task_id查询有效期为24小时。

curl -X GET "https://token.taiha.cn/v1/video/generations/<TASK_ID>"
-H "Authorization: Bearer <Model ID>"

输出示例

{
"code": "success",
"message": "",
"data": {
"id": 20,
"created_at": 1785161936,
"updated_at": 1785162042,
"task_id": "task_YvS3Wuau3aYnhJZYcaFwNlLd8NqkUIeo",
"action": "generate",
"status": "SUCCESS",
"fail_reason": "",
"result_url": "https://dashscope-a717.oss-accelerate.aliyuncs.com/1d/91/20260727/8fe28795/50976025-metadata_video_720p_4e200a08-0440-419b-93cf-a32e4957e6c4_refiner_watermark.mp4?Expires=1785248437\u0026OSSAccessKeyId=LTAI5tPxpiCM2hjmWrFXrym1\u0026Signature=v0IwJwMFMkhO%2FHqQ2koqhrGcnPI%3D",
"submit_time": 1785161936,
"start_time": 1785161946,
"finish_time": 1785162042,
"progress": "100%",
"properties": {
"input": "",
"upstream_model_name": "happyhorse-1.1-i2v",
"origin_model_name": "happyhorse-1.1-i2v"
},
"data": {
"usage": {
"SR": 720,
"duration": 5,
"video_count": 1,
"input_video_duration": 0,
"output_video_duration": 5
},
"output": {
"task_id": "4e200a08-0440-419b-93cf-a32e4957e6c4",
"end_time": "2026-07-27 22:20:39.186",
"video_url": "https://dashscope-a717.oss-accelerate.aliyuncs.com/1d/91/20260727/8fe28795/50976025-metadata_video_720p_4e200a08-0440-419b-93cf-a32e4957e6c4_refiner_watermark.mp4?Expires=1785248437\u0026OSSAccessKeyId=LTAI5tPxpiCM2hjmWrFXrym1\u0026Signature=v0IwJwMFMkhO%2FHqQ2koqhrGcnPI%3D",
"orig_prompt": "第1个镜头 大远景开篇,镜头从接近地面的低机位开始向前移动,镜头沿草原方向推进,同时向上移动,将视角从贴地逐渐抬升至略高位置,使猎豹从左侧进入画面并与前方逃窜的羚羊共同处于同一追逐路径中,建立清晰的前后空间关系。 第2个镜头 向下移动回到接近地面高度,并沿猎豹运动方向向右移动,与其保持侧向平行关系进行稳定跟随,主体始终处于画面中部偏左位置,背景产生连续横向位移效果,在这一阶段镜头运动保持稳定一段时间以强化速度感与空间连续性。 第3个镜头 在维持向右移动的同时,沿猎豹运动路径内侧做小幅弧线移动,使画面产生轻微绕行变化但始终保持与主体同向。 第4个镜头 逐渐减缓横向移动速度并过渡为机位相对稳定,同时执行变焦推进,将视觉焦点逐步压缩至猎豹与羚羊之间不断缩短的距离上。 第5个镜头 再次向前移动并轻微向下移动,贴近地面逼近两者之间的空间,在猎豹前肢逼近羚羊后方的临界位置停住,形成强烈压迫感与张力,同时配合逐渐增强的交响配乐、持续加密的鼓点、风声与踏地声推进节奏,并在最后阶段压低音乐仅保留环境声与节奏声形成短暂停顿。",
"submit_time": "2026-07-27 22:18:55.984",
"task_status": "SUCCEEDED",
"scheduled_time": "2026-07-27 22:18:56.042"
},
"request_id": "5a336216-5807-95cd-b3e8-9ad2ee4de335"
}
}
}

任务状态

  • queued: 排队中
  • in_progress: 生成中
  • completed: 已完成
  • failed: 失败

进阶使用

实现声画同步
支持模型wan2.7系列、wan2.6系列、wan2.5系列模型
功能介绍:让照片中的人物“开口说话”或唱歌,嘴型与音频匹配。

参数设置:

  • 传入音频文件:传入 audio_url。模型会根据音频文件对齐口型。
  • 自动配音:默认输出有声视频,无需传入 audio_url。模型会根据画面自动生成背景音效、音乐或人声。

代码示例

"input": {
"prompt": "一幅史诗级可爱的场景。一只小巧可爱的卡通小猫将军,身穿细节精致的金色盔甲,头戴一个稍大的头盔,勇敢地站在悬崖上。他骑着一匹虽小但英勇的战马,说:”青海长云暗雪山,孤城遥望玉门关。黄沙百战穿金甲,不破楼兰终不还。”。悬崖下方,一支由老鼠组成的、数量庞大、无穷无尽的军队正带着临时制作的武器向前冲锋。这是一个戏剧性的、大规模的战斗场景,灵感来自中国古代的战争史诗。远处的雪山上空,天空乌云密布。整体氛围是”可爱”与”霸气”的搞笑和史诗般的融合。",
"audio_url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20250923/hbiayh/%E4%BB%8E%E5%86%9B%E8%A1%8C.mp3"
}

模型能力

模型ID适用场景最大分辨率最大时长
happyhorse-1.1-t2v文生视频720P, 1080P3-15秒
wan2.7-t2v-2026-06-12文生视频,自定义音频文件720P, 1080P2-15秒
happyhorse-1.1-i2v首帧生视频720P, 1080P3-15秒
wan2.7-i2v-2026-04-25首帧生视频、首尾帧生视频、视频续写720P, 1080P2-15秒
happyhorse-1.1-r2v参考图像生视频720P, 1080P3-15秒
wan2.7-r2v-2026-06-12参考图像和视频生视频720P, 1080P2-10秒
happyhorse-1.0-video-edit视频编辑720P, 1080P3-15秒
wan2.7-videoedit视频编辑、特效复刻、运镜复刻720P, 1080P2-10秒
wan2.2-animate-move动作迁移到静态人物720P2-30秒
wan2.2-animate-mix视频中替换人物720P2-30秒