可灵1.6模型已上线,显著提升动作合理性、表情自然度与物理细节:一、文本响应增强,精准解析多主体动作与专业运镜;二、动态质量跃升,强化流体、形变与接触反馈建模;三、微表情与情绪连贯性优化;四、光影渲染与特效表现升级;五、支持跨视频动作迁移与多主体解耦控制。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

如果您在可灵AI平台中使用图生视频或文生视频功能,发现生成结果在动作合理性、表情自然度或物理细节上存在明显提升,则很可能是可灵1.6模型已生效。以下是该版本的具体改进说明:
一、文本响应能力显著增强
可灵1.6对运动类、时序类及运镜类提示词的理解精度大幅提高,能更准确解析方位、角色定位与动作顺序等复杂语义结构,从而减少指令误读导致的动作错位或对象混淆。
1、输入含多主体动作指令(如“左边的人比爱心,右边的人挥手说拜拜”)时,模型可严格按空间位置分配对应动作;
2、对“熟练快速弹钢琴”“身体律动弹吉他”等复合动词短语的响应更趋精准,肢体节奏与演奏逻辑高度匹配;
3、支持希区柯克变焦、推拉摇移等专业运镜术语的直接调用,无需额外拆解为分步描述。
二、动态质量与物理真实感跃升
该模型强化了流体运动、物体形变、接触反馈等底层物理建模能力,使切菜、倒水、坠落、旋转等单点交互行为更符合现实世界规律,尤其在材质反馈与力传导表现上实现突破。
1、生成“猫咪切胡萝卜”或“厨师切肉”场景时,刀具切入角度、食材形变幅度与断面纹理均保持合理一致性;
2、对“陀螺旋转后自然停止并倾倒”类连续物理过程虽尚未完全达标,但沙地等软质表面的停止形态已接近真实;
3、多人群舞场景下,肢体摆动幅度、重心转移节奏与队形变化逻辑均呈现高协调性,100镜实测验证其可稳定输出女团级群舞视频。
三、人物表情与表演自然度优化
模型在微表情建模与情绪连贯性方面进行专项训练,使人物在执行复杂情感组合动作(如委屈流泪同时比爱心)时,面部肌肉运动路径更符合生物力学特征,避免僵硬割裂感。
1、输入“女孩委屈、流泪、比爱心、微笑”等多情绪叠加指令,模型能分层调度泪腺分泌、嘴角牵拉与眼轮匝肌收缩节奏;
2、对口型同步能力虽未开放独立模块,但在带语音驱动的测试中,唇部开合幅度与音节时长匹配度较1.5版本提升明显;
3、人物眼神焦点、眨眼频率与头部微倾角度随动作动态调整,增强镜头内角色可信度。
四、画面美感与特效表现升级
通过重构光影渲染管线与色彩映射策略,1.6在保持1080p分辨率前提下,显著提升运动区域的锐度保留率、金属反光质感与粒子特效的空间层次感,避免高频细节在动态中丢失。
1、生成“运动员骑行时空间色彩变幻”视频,色相过渡平滑且与速度矢量方向强关联;
2、“武器被光粒子缠绕并发光”类特效中,粒子密度梯度、辉光扩散半径与剑身曲率严格耦合;
3、静态构图稳定性增强,同一提示词多次生成的画面中,主体占比、景深分布与明暗分区一致性达92.7%以上。
五、多主体识别与动作控制能力拓展
模型新增基础级动作迁移能力,支持从参考视频中提取肢体运动轨迹,并将其复用于目标图像中的人物,实现跨素材的动作复刻,适用于写实、2D及3D类人角色。
1、上传3秒人物行走视频后,可驱动静态图中角色完成同风格步行序列,步幅、摆臂相位与重心起伏完全一致;
2、手部精细动作(如握拳、翻转、抓取)迁移成功率超86%,指尖关节弯曲弧度与受力方向建模准确;
3、多主体场景中,各角色动作解耦能力增强,避免出现“一人抬手全体抬手”的群体动作崩坏现象。


















