近些年来,数据库领域飞速发展,涌现了云数据库、分布式数据库等多种新型数据库。本专... 展开 >





庄晓丹,Greptime 联合创始人。15 年程序员老兵,长期从事基础软件研发,经历在大厂和创业之间来回切换,开源爱好者,改装车爱好者。开源作品包括 AviatorScript、MetaQ、SOFAJRaft、GreptimeDB 等

Datafuse Labs 联合创始人 ,前阿里云数据库内核组早期成员、前青云数据库团队负责人。 开源 Databend 项目主要负责人。
近些年来,数据库领域飞速发展,涌现了云数据库、分布式数据库等多种新型数据库。本专题希望邀请到明星项目的核心成员前来分析设计思路,同时也会邀请相关企业团队基于自身业务分享数据库选型的思考及落地经验。
随着企业上云和云原生基础服务的发展,作为需要存储和处理海量传感器数据的时序数据库也需要往云原生架构迁移。在这一过程中面临诸多挑战:
我们在实现 GreptimeDB 这个分布式、云原生的时序数据库过程中,直面这些挑战,并将在本次演讲中给出我们的设计选择和背后的思考,和大家一起探讨。
演讲提纲:
1. 什么是时序数据?GreptimeDB 简介
2. 时序数据特有的问题
3. 面向弹性设计的 ServerlessDB 架构
4. 展望
你将获得:
ByConity 是字节跳动开源的云原生数仓系统。ByConity 站在 ClickHouse 的肩膀上,基于云原生架构重构设计,并新增和优化了大量功能。在字节内部,ByConity 的内部版本被广泛用于各类实时分析领域。本分享将介绍 ByConity 的整体架构和核心功能,如存算分离、事务、查询执行模型、数据去重和更新等,并集合字节内部的应用案例,阐述实时数仓的面对的主要挑战和解决方案。
演讲提纲:
1. ByConity 背景
2. 整体架构和基础概念
3. 核心功能
4. 应用案例
5. 总结和展望
你将获得:
本次分享聚焦于大模型时代下的 Cloud Warehouse 设计探索,分析如何利用开源与商业 LLMs 提升 Cloud Warehouse 的能力,实现更智能、自动化的数据分析。
演讲提纲:
1. 开源和商业 LLMs 现状
2. Cloud Warehouse 现状与技术挑战
3. Cloud Warehouse 与 LLMs 的融合方向与创新点
4. 利用 LLMs 为 Cloud Warehouse 数据集“训练”(Embedding)
5. 基于自有数据集构建一个类似 ChatGPT 智能问答系统
听众收益:
通过一些最佳实践,你将会了解到如何借助AntKV取得5x性能提升。同时,你也可以了解到针对 KV 分离的 Scan 性能优化思路,以及基于机器学习的 Learned Index 如何提高查询性能。本次演讲将分享以上经验。
演讲提纲:
1. AntKV 概述
2. 针对 KV 分离的 Scan 性能优化探索
3. 借助 Learned Index 提升查询性能
你将获得:



微信咨询

电话咨询
领取往期热门演讲视频

