类 Sora 开源架构模型训练实践

所属专题:大模型训练和推理工程

嘉宾 : 卞正达 | 北京潞晨科技有限公司CTO

会议室 : VIP 1

讲师介绍

专题演讲嘉宾:卞正达

北京潞晨科技有限公司CTO

现任潞晨科技 CTO,毕业于新加坡国立大学,曾在全球超算最顶尖会议 SC 上发表一作论文,拥有 7 年高性能 AI 系统经验,Colossal-AI 系统核心开发者。

议题介绍

演讲:类 Sora 开源架构模型训练实践

随着视频内容创作和消费的迅猛增长,OpenAI Sora 凭借其出色的视频生成技术成为行业的领跑者。紧随其后,Colossal-AI 团队率先推出类 Sora 架构开源视频生成模型 Open-Sora 1.0。

本次演讲将详细介绍 Open-Sora 1.0 的复现方案,包括其三个关键阶段的训练流程:大规模图像预训练、视频预训练和数据微调,以及这些步骤如何共同作用于提升生成视频的质量和真实感。此外,演讲还将探讨数据预处理、模型训练细节和加速优化策略,以及未来的发展计划。

演讲提纲:

  1. 视频生成模型的发展和背景
  2. Open-Sora 1.0:类 Sora 开源架构模型的介绍
  3. 数据预处理和模型训练细节的深入剖析
  4. 模型训练加速优化的策略和实践
  5. 未来计划和开源社区的参与方式

听众收益:

  • 深入了解 Open-Sora 1.0 模型,包括其在视频生成领域的创新应用和实际效果
  • 掌握模型的关键技术特点,学习高效数据处理与训练流程,实现高质量视频生成
  • 了解如何将先进技术应用于项目中,提升内容创作质量与效率。
  • 了解模型未来发展方向,把握视频生成技术最新趋势,激发研究或创作灵感

方案痛点:

  • 视频生成的成熟度。目前,Open-Sora 1.0 的视频生成功能尚未完全成熟,需要进一步优化以提高视频的时长、分辨率和整体质量

  • 训练与推理优化。为了提升性能,Open-Sora 1.0 正在积极进行训练推理部分的优化工作,以期达到更高效的视频处理能力

交通指南

北京国测国际会议会展中心

GUOCE International Convention And Exhibition Center
地址:北京市顺义区临空经济核心区汇海南路6号院20号楼
  • 微信咨询

  • 电话咨询

    联系电话:+86 17310043226

微信联系我们

如您在购票过程中遇到问题,请扫码咨询票务小助手