本文提出ReactID框架,旨在协调个性化视频生成中身份一致性与动作真实性的矛盾。针对主体-视频对齐不精确、训练不稳定、细粒度动作建模不足三大挑战,从数据、训练和动作建模三方面协同改进:构建高精度标注的ReactID-Data数据集;设计由易到难的渐进式训练课程;提出基于时间线的条件机制,通过主体感知交叉注意力和时间自适应RoPE,将子动作与特定主体绑定并嵌入时间坐标,从而生成更自然、可控的视频。