HappyHorse 1.1发布:视频生成能力升级,强化动作、主体一致性与音画同步

HappyHorse 1.1上线,重点升级视频动作、角色一致性、画质与音画同步能力。

原文标题:HappyHorse 1.1来了!现已登陆千问云

原文作者:阿里云开发者

冷月清谈:

HappyHorse 1.1视频生成模型已上线官网、千问云和阿里云百炼平台。本次更新主要围绕专业内容生产场景展开,重点提升动态表现力、主体一致性、指令遵循、视觉质感和音频表达能力。新版本优化了运动建模与时序一致性,改善动作迟缓、节奏不足等问题;多图参考生视频能力支持最多9张角色参考图输入,有助于维持商品细节、品牌元素和角色形象稳定;在提示词理解方面,既能处理简洁动作指令,也能承接多角色、多场景的复杂叙事。画面表现上,1.1缓解了此前用户反馈的“油光感”“过度锐化”等问题,并增强对正反打、跟拍等镜头语言的理解。音频方面,模型可根据场景调整语速、停顿和语气,并支持在提示词中描述背景音乐、环境音等元素,音画同步精度也有所提升。上线期间官方提供限时6折优惠,720p折后0.54元/秒,1080p折后0.72元/秒。

怜星夜思:

1、AI视频模型现在都在强调“主体一致性”,你觉得这对短剧、广告创作到底有多关键?
2、这类视频生成模型按秒收费,你觉得现在的价格更适合个人创作者,还是更适合团队和企业?
3、文章提到能改善“油光感”和“过度锐化”,你觉得AI视频画质最影响观感的问题是什么?
4、如果AI视频模型已经能理解复杂提示词,创作者未来更需要写分镜,还是更需要懂导演语言?

原文内容

视频生成模型 HappyHorse 1.1 正式发布,现已登陆 HappyHorse 官网、千问云及阿里云百炼平台。
相较1.0版本,HappyHorse 1.1围绕动态表现力、主体一致性、指令遵循、视觉呈现质量、音频表达能力等维度进行了系统升级,进一步提升模型在专业内容生产场景中的创作质量、可控性与应用效率。

动态表现力提升,动作更连贯

针对1.0版本部分画面动作迟缓、节奏不足的问题,1.1版本优化了运动建模与时序一致性能力,提升了复杂动作场景下的连贯性和力量感。

支持9张参考图输入,主体一致性增强

1.1版本的多图参考生视频(R2V)能力支持9张角色参考图同时输入,可保持商品细节、品牌元素稳定,多分镜与N宫格参考理解增强。在多角色短剧、直播带货、多人物广告等场景中,角色一致性更加可控。

指令遵循能力增强,

适配简洁与复杂提示词

1.1版本强化了长上下文语义理解与镜头编排稳定性。对于打斗等高强度动态场景,简洁提示词即可理解;对于复杂叙事输入,可完成多场景、多角色的连贯演绎。

视觉质感优化,

缓解“油光感”与“过度锐化”

此前用户反馈集中的"油光感""过度锐化"等问题在1.1版本中得到缓解,模型在保留痘印、法令纹、毛孔等细节真实感的基础上,降低了涂抹感,可满足短剧、广告等对画面质感要求较高的场景。同时增强了对正反打、跟拍等专业镜头语言的理解。

音频能力优化,音画同步精度提升

台词表达方面,语速、停顿、语气可根据场景与情绪变化动态调整。用户可在提示词中描述背景音乐、环境音效等声音元素。音画同步能力进一步增强,降低了声音与画面动作之间的错位。

HappyHorse 1.1上线期间提供限时6折优惠,720p分辨率官方刊例价0.9元/秒,折后每秒0.54元;1080p分辨率官方刊例价1.2元/秒,折后每秒0.72元

立即体验HappyHorse1.1模型——

  • HappyHorse官网:

    https://www.happyhorse.cn/

  • 千问云:

    https://www.qianwenai.com/models/happyhorse-1.1-i2v

  • 阿里云百炼

    https://bailian.console.aliyun.com/cn-beijing#/model-market/all?providers=happyhorse

/ END /

关于“主体一致性”,我感觉它是AI视频从玩具走向工具的分水岭。单条炫技视频可以靠氛围糊过去,但一旦要做多镜头、多分镜,角色稳定性就是最基础的生产要求。

2 个赞