现任潞晨科技 CTO,毕业于新加坡国立大学,曾在全球超算最顶尖会议 SC 上发表一作论文,拥有 7 年高性能 AI 系统经验,Colossal-AI 系统核心开发者。

现任潞晨科技 CTO,毕业于新加坡国立大学,曾在全球超算最顶尖会议 SC 上发表一作论文,拥有 7 年高性能 AI 系统经验,Colossal-AI 系统核心开发者。
随着视频内容创作和消费的迅猛增长,OpenAI Sora 凭借其出色的视频生成技术成为行业的领跑者。紧随其后,Colossal-AI 团队率先推出类 Sora 架构开源视频生成模型 Open-Sora 1.0。
本次演讲将详细介绍 Open-Sora 1.0 的复现方案,包括其三个关键阶段的训练流程:大规模图像预训练、视频预训练和数据微调,以及这些步骤如何共同作用于提升生成视频的质量和真实感。此外,演讲还将探讨数据预处理、模型训练细节和加速优化策略,以及未来的发展计划。
演讲提纲:
听众收益:
方案痛点:
视频生成的成熟度。目前,Open-Sora 1.0 的视频生成功能尚未完全成熟,需要进一步优化以提高视频的时长、分辨率和整体质量
训练与推理优化。为了提升性能,Open-Sora 1.0 正在积极进行训练推理部分的优化工作,以期达到更高效的视频处理能力



微信咨询

电话咨询
微信联系我们

