

作为钉钉业务的坚实基石,阿里云瑶池旗下的云原生数据库PolarDB PostgreSQL版(以下简称PolarDB-PG)与钉钉持续书写合作新篇章。
继成功支持钉钉宜搭和AI表格等核心应用后,PolarDB-PG近日新增支撑了钉钉全新业务——钉钉ONE。面对钉钉ONE对高并发、百亿级数据存储以及大规模向量召回的严苛需求,PolarDB-PG正凭借其独特的分布式架构优势和强大的向量检索能力,为这一创新业务提供稳定可靠且高效的底层数据支撑。

钉钉发布全新的钉钉 ONE 功能


钉钉 ONE 的架构

PolarDB-PG:处理复杂的用户可见性控制、多个索引、跨表关联查询的场景,作为基础 Item 数据底表存储。 表格存储:适用于高吞吐写入的流水型数据、按用户分区的简单读写场景。 图数据库:用于存储用户关系网络、行为图谱及反向边索引。
流批计算引擎:实时数据管道,处理可见性扩散、埋点数据清洗等流式计算任务。
多路召回策略:包含高优内容召回、长短周期兴趣捕捉、协同过滤召回以及其他召回方式,在不同内容和业务场景下使用不同组合的召回方式。

PolarDB-PG 分布式向量检索

海量存储与横向扩展:能够将向量数据分布到多个节点上,轻松扩展至PB级海量存储,突破了单机存储的限制。 高性能并行处理:通过跨节点并行能力,多个节点可以同时执行向量相似度计算,显著提高检索速度,尤其适合处理亿级甚至十亿级的高维向量数据。
分布式架构

计算节点(Compute Nodes,简称 CN):负责集群分布式查询计划制定、元数据管理等。 数据节点(Data Nodes,简称 DN):负责实际数据分片的存储。
向量检索能力


PolarDB-PG 的解决方案
挑战:表结构设计

挑战:数据库扩容

CN (计算节点)可以做到完全无感扩容,可以通过自定义地址自动进行负载均衡,可以支持海量的连接进行高并发处理。 DN(数据节点)大部分时间可以不阻塞读写地进行数据重分布,仅在最后阶段会有数秒的锁表时间。
挑战:高性能数据库

PolarStore是高度软硬协同设计的全用户态分布式存储,结合业务负载特点,充分发挥出RDMA、NVMe、Optane、大内存、多核等硬件的性能,进行了IO全链路用户态和ZeroCopy、IO全链路并行执行、全栈组件异步化编程等优化。


业务展望
作为钉钉One资讯推荐系统的核心数据库,PolarDB-PG展现了卓越的技术实力。它不仅能稳定承载百亿规模的数据,还在向量检索、可见性JOIN等多元混合查询场景中,实现了10w+TPS的顶尖性能,配合其弹性扩展特性,为钉钉One全量功能提供了坚实可靠的支撑。
—— 钉钉相关业务负责人



点击阅读原文了解PolarDB-PG更多内容



文章转载自阿里云瑶池数据库,如果涉嫌侵权,请发送邮件至:contact@modb.pro进行举报,并提供相关证据,一经查实,墨天轮将立刻删除相关内容。




