
湖北日报全媒记者黄洁如 杨千帆股票配资资讯平台
当AI短视频随处可见,一部90分钟、能登上院线大银幕的AI长片,仍是行业难以跨过的坎。AI生成画面里,上一场还是一张脸,下一场就容貌大变;人物肢体扭曲;同一个房间换个镜头,陈设风格完全错乱。这些观众一眼能察觉的bug,正是AI通往真正电影的障碍。
眼下,在武汉光谷,蔡新元博士带领的团队,正试图用自研多模态AI生产平台“爱乌”,解开这些死结。
很多人认识这支团队,是从长江灯光秀、黄鹤楼、江汉关那些璀璨的城市夜晚光影开始。作为光影交互服务技术文化和旅游部重点实验室,团队过去把数字光影投射到城市江滩与古建筑上,打造出多个出圈文旅夜游项目。但从2018年起,蔡新元已把目光望向更远处:人工智能会怎样改写内容创意的生产方式。
蔡新元在实际试用通用工具时却屡屡碰壁:工具不少,各有短板,做一段内容要在多个平台来回跳转,参数反复调试,结果好坏全靠“抽卡碰运气”。“当时只是想给自己做一个顺手的小工具。”他回忆,开发平台的念头出发点很朴素。
2025年12月,项目正式立项。没有现成套件可用,第一行代码由蔡新元亲手敲下,随着越写越多,整整敲击了近70万行。此后半年,三十多位师生组成研发团队扎进迭代,原本个人用的小工具,逐步生长为完整的多模态AI生产平台“爱乌”,并于2026年6月6日光谷人工智能创意技术研究院成立大会上正式亮相,开启公测。
团队不选择做大基础大模型。在他们看来,性能强悍的大模型如同大功率发动机,但光有发动机造不出能上路的车,真正的难点在于如何驯服大模型,把算力收敛到电影创作的严谨规则之内。
平台内部集结137个模型,48个为公用基础模型,其余口型校准、调色、自动剪辑、动画适配等专用小模型全部自主训练。最硬核的三座大山,是人物、动作、场景的三重一致性控制,也是当下多数AI视频产品的软肋。
人物一致性并非简单固定一张人脸。故事里人会老去、换装,样貌理应合理变化,但观众得确认:这还是同一个人。团队要对抗的,是AI常出现的“换脸式跳变”。动作层面更考验物理逻辑。角色奔跑、打斗,肢体不能出现现实人类无法完成的扭曲;多人交手,身体之间要有合理碰撞与遮挡,光影阴影也要联动。场景一致性则要守住空间真实。镜头平移、旋转、切换角度后,建筑结构、陈设氛围不能前后矛盾。
蔡新元在“爱乌”平台演示:就算是虚拟人物也要符合物理常识
经过大量调优,平台把反复试错的“抽卡”概率压得很低,不少镜头生成一到两次就能拿到可用高质量版本。
和很多AI工具热衷比拼提示词技巧不同,蔡新元团队坚持另一条路径:让技术隐身,让艺术回归创作者。
真正导演构思画面,不会写上千字文字描述。他们会思考用什么摄影机、85毫米定焦还是120毫米长焦、光圈开大还是收小、用什么画幅。“爱乌”把这套电影工业逻辑搬进平台。创作者可直接勾选镜头、光圈、画幅,也可语音讲出想法,后台自动完成翻译、解析,转化为机器指令。创作者不必变成AI专家,只需沿用导演原本的创作习惯。
蔡新元在“爱乌”平台演示镜头选项
目前平台已邀请50家文创产业单位参与首轮内测,反馈正向,但测试名单保密。团队没有跟风追逐大模型每半个月一次的版本更新。“作为生产工具,稳定优先于追新。”蔡新元说,他们要沉下心消化内测反馈,完成一轮重大升级,再向更广阔的创作者开放。
从城市江面光影秀,到挑战院线级AI长片股票配资资讯平台,这支来自华中科技大学设计学院的团队目标明确:制作一部90分钟以上、达到院线放映标准的AI电影,古装题材正在规划中。
和业众配资提示:文章来自网络,不代表本站观点。