专题演讲嘉宾:郑重

生数科技解决方案负责人

现任生数科技解决方案负责人,拥有 16 年 AI 大模型、多模态人工智能应用、营销智能领域从业经验,贯通AI底层技术体系与产业商业化落地全链路。

历任字节跳动解决方案高级总监、百度智能云解决方案副总经理,具备深厚的企业级AI场景落地与产业服务经验。

作为资深多模态AI领域专家,系统掌握视频生成大模型底层架构原理,深耕帧间一致性、推理加速、跨模态对齐等AIGC核心技术体系,具备通用多模态大模型全局技术认知与行业研判能力。立足各产业数字化升级的核心诉求,打造兼具技术创新性与场景适配性的AIGC产业解决方案。长期为英特尔、可口可乐、耐克、宝洁、联合利华、宝马等国际头部企业提供深度定制化AI服务,实现社交数字人、智能营销素材、AI影视短剧工业化生成等场景的规模化落地。依托自研多模态视频大模型技术底座,构建稳定、高效、可规模化的AIGC内容生产体系,以前沿AI技术推动全域内容产业生产力与生产范式革新。

by 郑重

生数科技
解决方案负责人

视频生成模型正在从“生成一段可看的视频”进入更复杂的阶段:它需要在多主体、多镜头、长时序和交互场景下保持一致性、可控性和实时响应能力。这些问题不仅决定了生成效果,也决定了视频 AIGC 能否真正进入专业内容生产和实时互动场景。
本次分享将围绕视频生成中的关键技术挑战展开,包括角色与场景一致性、参考驱动生成、镜头与叙事控制、流式视频生成以及世界模型方向的探索。分享将结合 Vidu 在模型迭代和场景实践中的技术路径,讨论视频生成模型如何从离线生成工具,逐步演进为可控、可交互、可扩展的内容生产基础能力。

演讲大纲

  1. 视频生成模型面临的关键挑战:从图像生成到视频生成,难点不只是增加时间维度,而是如何在连续画面中保持主体、场景、动作、风格和叙事逻辑的一致。分享将首先拆解当前视频生成在多主体一致性、长时序稳定性、动作控制、镜头语言和实时响应方面的主要瓶颈。
  2. 一致性:从随机生成到参考驱动生成
    • 视频内容生产需要模型稳定复现角色、商品、场景和风格。分享将介绍参考生视频、参考生图、主体保持等能力所解决的问题,以及它们如何降低多镜头、多场景创作中的断裂感。
  3. 可控性:从画面生成到镜头与叙事控制
    • 专业视频创作并不只是生成画面,还需要理解剧本、角色关系、情绪变化、动作节奏和镜头调度。分享将结合 AI 剧创作场景,讨论模型如何完成脚本理解、智能分镜、运镜规划和多镜头一致性控制。
  4. 实时性:从离线生成到流式交互
    • 传统视频生成通常是输入提示词后等待结果,难以支撑实时互动体验。分享将介绍 Vidu S1 流式视频生成模型的方向,重点讨论秒级响应、无限互动时长、双向感知、即时指令遵循和多模态输入输出对交互式内容生产的意义。
  5. 从世界生成到世界行动
    • 视频模型不仅生成画面,也在学习对时空、动作和物理世界的理解。分享将介绍生数科技在世界行动模型方向的探索,讨论视频生成、世界模型与具身智能之间的关系。
  6. 总结:视频 AIGC 的技术演进路径
    • 回到整体技术路线,总结视频生成模型如何从“可生成”走向“可控生成”,再走向“实时交互”和“世界理解”。


听众收益  

  • 理解视频生成模型在一致性、可控性、长时序和实时交互上的核心难点。  
  • 了解参考驱动生成、智能分镜、镜头控制、流式生成等能力背后的技术价值。  
  • 获得视频 AIGC 从 Demo 走向专业内容生产场景时需要解决的问题框架。  
  • 看到视频生成模型向世界模型、具身智能方向演进的技术趋势。

交通指南

上海建工浦江皇冠假日酒店

Shanghai Construction Group Pujiang Crowne Plaza Hotel
地址:上海市闵行区陈行公路 3701 号
  • 微信咨询

  • 电话咨询

    联系电话:18514549229

微信联系我们

如您在购票过程中遇到问题,请扫码咨询票务小助手