让主体与场景有据可循
创作不必只靠文字描述外观。将主体图、场景图与动作提示一同提交,模型可以围绕明确的视觉参考生成片段,其能力重点是主体与场景参考的稳定性。适合需要保留角色辨识度、商品形态或视觉方向的短片,但不等于逐像素复制图片。
在选型前明确容量、输入输出与调用方式。
多图参考和图文生成属于模型能力;时长、画幅及任务交付方式按本平台调用范围列示。
了解 happyhorse-1.0-r2v 能为你的工作带来什么。
创作不必只靠文字描述外观。将主体图、场景图与动作提示一同提交,模型可以围绕明确的视觉参考生成片段,其能力重点是主体与场景参考的稳定性。适合需要保留角色辨识度、商品形态或视觉方向的短片,但不等于逐像素复制图片。
一次任务可提交1–9张参考图,并在提示词中按顺序使用character1、character2等名称指代图片。可以分别说明主体来自哪张图、希望采用什么场景或视觉元素,再描述动作与镜头,减少多图输入时创作关系含混的问题。
平台提供3–15秒生成时长、720P与1080P清晰度,以及横屏、竖屏和方形等画幅选择。任务可异步提交,再通过查询或回调获取结果,适合把参考图创作接入素材管理、内容审核和下载流程,而不必一直等待请求完成。
从具体任务出发,找到模型发挥作用的位置。
输入商品参考图和展示环境图片,用文字说明商品摆放、镜头推进与画面氛围,生成适合营销方案预览的短片。参考图负责传达外观,提示词负责组织动作;交付前重点检查标识、结构和细小文字,避免把生成画面直接当作精确商品记录。
将角色设定图与场景参考图组合,描述角色进入画面、转身或行走等单段动作,生成分镜预演素材。适合在拍摄或动画制作前讨论人物与环境的关系;多个镜头可分别生成,再检查角色外观是否衔接,而不是假设跨任务自动保持连续性。
围绕同一组参考图,分别组织横屏、竖屏或方形构图,生成用于不同展示位置的短视频候选。每次提示词都说明主体位置与镜头重点,便于比较画幅取舍。输出视频可进入剪辑流程,继续添加字幕、声音和品牌信息。
结合任务复杂度、输入材料与预期结果选择。
需要综合角色、道具和场景参考时,选择1.0-r2v;如果关键要求是让某张图片成为视频首帧,应选择i2v变体。只有文字构想时可考虑t2v;已经有视频并希望换装或修改视觉风格时,应选择video-edit。它们对应不同输入方式,不能只更换动作名称就视为同一能力。
1.0-r2v与1.1-r2v是不同的调用型号,参考图生成默认选择1.1。已有围绕1.0建立的提示词和素材测试集时,可显式指定1.0继续评估;尝试1.1时,建议用相同参考图和任务比较主体保留与镜头表达,不把版本编号直接理解为固定幅度的质量提升。
从一次小规模任务到正式接入。
明确目标、必要输入与输出要求,使用真实业务样例作为起点。
打开试用页,确认此入口支持的参数,再提交小规模任务查看结果。
保留完整模型 ID,使用文档规定的请求格式,并在 Pricing 页确认计费规则。
在正式使用前,了解输出质量与能力范围。
解答使用 happyhorse-1.0-r2v 时的常见疑问。
向/happyhorse/videos提交请求,明确设置model为happyhorse-1.0-r2v、action为reference_to_video,并提供prompt与1–9张image_urls。不要依赖默认动作或默认型号,否则可能与参考图生成任务不匹配。
可以,参考图数量从1张开始。一张图适合提供主体或视觉方向,多张图适合补充不同参考关系。如果要求这张图片直接成为首帧,应选择i2v变体;R2V的重点是利用参考信息创作新的片段。
按image_urls中的排列顺序,用character1、character2等名称指代对应图片,并明确各自用途。例如说明主体参考第一张图、视觉元素参考第二张图,再描述动作和镜头。图片顺序调整后,也应同步修改提示词。
不要将对白、口型同步或原音频保留作为1.0-r2v的已确认功能来设计任务。它的明确用途是图文参考生成视频;保留现有视频音频属于video-edit的操作方式。需要确定声音内容时,可在后期完成配音与混音。
使用async提交后保留task_id,通过/happyhorse/tasks查询;也可提供callback_url接收完成结果。任务状态包括pending、succeeded和error。成功后获取video_url,并结合返回的时长、分辨率检查成片是否符合本次任务要求。
模型资料 · 更新日期:2026-10-01。调用参数与计费规则请查看 API 和定价栏目。