新型数据库

会议室:多功能厅 5+6
出品人:庄晓丹出品人:张雁飞

近些年来,数据库领域飞速发展,涌现了云数据库、分布式数据库等多种新型数据库。本专... 展开 >

专题出品人:庄晓丹

Greptime 联合创始人

庄晓丹,Greptime 联合创始人。15 年程序员老兵,长期从事基础软件研发,经历在大厂和创业之间来回切换,开源爱好者,改装车爱好者。开源作品包括 AviatorScript、MetaQ、SOFAJRaft、GreptimeDB 等

专题出品人:张雁飞

Datafuse Labs 联合创始人

Datafuse Labs 联合创始人 ,前阿里云数据库内核组早期成员、前青云数据库团队负责人。 开源 Databend 项目主要负责人。

地点:多功能厅 5+6

专题:新型数据库

近些年来,数据库领域飞速发展,涌现了云数据库、分布式数据库等多种新型数据库。本专题希望邀请到明星项目的核心成员前来分析设计思路,同时也会邀请相关企业团队基于自身业务分享数据库选型的思考及落地经验。

by 冯家纯

Greptime
联合创始人

随着企业上云和云原生基础服务的发展,作为需要存储和处理海量传感器数据的时序数据库也需要往云原生架构迁移。在这一过程中面临诸多挑战:

  • 面向弹性设计的 ServerlessDB 架构
  • 海量规模的时序数据在高并发读写下的可用性和稳定性挑战
  • 时序数据特有的高基数问题和数据压缩问题
  • 存算分离架构带来的性能挑战
  • 混合时序和分析负载带来的算力隔离和调度问题

我们在实现 GreptimeDB 这个分布式、云原生的时序数据库过程中,直面这些挑战,并将在本次演讲中给出我们的设计选择和背后的思考,和大家一起探讨。

演讲提纲: 

1. 什么是时序数据?GreptimeDB 简介

2. 时序数据特有的问题

  • 高基数 
  • 数据压缩问题 

3. 面向弹性设计的 ServerlessDB 架构

  • 存算分离,算算分离
  • 时序和分析混合负载
  • ServerlessDB 的自动驾驶

4. 展望

你将获得:

  • 了解什么是时序数据库,有哪些特点和适用的场景
  • 了解如何解决时序数据库面临的特有挑战
  • 了解下一代面向云原生 Serverless 时序数据库的设计和思考

by 游致远

字节跳动
ByteHouse 资深研发工程师

ByConity 是字节跳动开源的云原生数仓系统。ByConity 站在 ClickHouse 的肩膀上,基于云原生架构重构设计,并新增和优化了大量功能。在字节内部,ByConity 的内部版本被广泛用于各类实时分析领域。本分享将介绍 ByConity 的整体架构和核心功能,如存算分离、事务、查询执行模型、数据去重和更新等,并集合字节内部的应用案例,阐述实时数仓的面对的主要挑战和解决方案。

演讲提纲:

1. ByConity 背景

2. 整体架构和基础概念

3. 核心功能

  • 存算分离
  • 事务实现
  • 唯一键约束
  • 查询引擎优化
    • 优化器
    • MPP 多阶段执行
    • 其他重要优化点,如 RuntimeFilter,表级别低基数

4. 应用案例

  • 行为分析场景
  • 数据洞察场景

5. 总结和展望

你将获得:

  • 以 ByConity 为例了解云原生实时面对的问题和解决方案
  • 了解 ByConity 的核心功能设计和近期功能规划
  • 了解 ByConity 的应用场景,技术挑战和应对策略

by 张雁飞

Datafuse Labs
联合创始人

本次分享聚焦于大模型时代下的 Cloud Warehouse 设计探索,分析如何利用开源与商业 LLMs 提升 Cloud Warehouse  的能力,实现更智能、自动化的数据分析。

演讲提纲:

1. 开源和商业 LLMs 现状

2. Cloud Warehouse 现状与技术挑战

3. Cloud Warehouse 与 LLMs 的融合方向与创新点

4. 利用 LLMs 为 Cloud Warehouse 数据集“训练”(Embedding)

5. 基于自有数据集构建一个类似 ChatGPT 智能问答系统

听众收益:

  • 了解开源和商业 LLMs 的发展趋势
  • 了解基于 LLMs 的 Cloud Warehouse 技术架构和实际应用场景
  • 学习如何针对自有数据集开发智能问答系统
  • 了解运用 AI 技术提升大数据分析效率的途径

by 刘达

蚂蚁集团
高级开发工程师

通过一些最佳实践,你将会了解到如何借助AntKV取得5x性能提升。同时,你也可以了解到针对 KV 分离的 Scan 性能优化思路,以及基于机器学习的 Learned Index 如何提高查询性能。本次演讲将分享以上经验。

演讲提纲:

1. AntKV 概述

  • 简介
  • 整体架构
  • 核心功能
  • 应用现状

2. 针对 KV 分离的 Scan 性能优化探索

  • 背景
  • 多线程预取加速
  • 精细化配置
  • 局部有序性优化

3. 借助 Learned Index 提升查询性能

  • 背景
  • 整体思路与模型
  • 读写链路

你将获得:

  • 了解 KV 分离在蚂蚁的最佳实践
  • 了解针对 KV 分离的性能优化思路
  • 了解机器学习在本地 KV 存储上的应用

交通指南

广州·粤海喜来登酒店

Hilton Guangzhou Baiyun
地址:广东省广州市天河区天河南街道天河路208号粤海天河城商业F3
  • 微信咨询

  • 电话咨询

    联系电话:+86 18514549229

领取往期热门演讲视频

领取往期热门演讲视频二维码
在报名过程中如有任何问题,欢迎微信扫描二维码联系我们的票务经理