This is the Trace Id: 2efa2c09da378297fc71c6f96e4eab19
跳转至主内容 浏览 查看所有产品 (200+) Microsoft Foundry Azure Copilot GitHub Copilot Azure Kubernetes 服务 (AKS) Azure Cosmos DB Azure Database for PostgreSQL Azure Arc Microsoft Fabric Azure 上的 Linux 虚拟机 Foundry 模型 Foundry 智能体服务 Foundry IQ Foundry Tools Foundry Control Plane Foundry Control Plane 中的可观测性 Foundry 模型中的 Azure OpenAI Foundry Tools 中的 Azure 语音 Azure 机器学习 查看所有数据库 Azure Cosmos DB Azure DocumentDB Azure SQL Azure Database for PostgreSQL Azure 托管的 Redis Microsoft Fabric Azure Databricks Azure 上的 Linux 虚拟机 Azure 上的 Windows Server Azure Functions Azure 虚拟机规模集 Azure API 管理 Azure 容器应用 Azure Kubernetes 服务 (AKS) Azure Kubernetes 舰队管理器 Azure 容器注册表 Azure Red Hat OpenShift Azure 容器实例 Azure 容器存储 Azure Arc Azure Local Microsoft Defender for Cloud Azure Monitor Microsoft Sentinel Azure Migrate 查看所有解决方案 (40+) 适用于中小型企业的云解决方案 云迁移和现代化中心 AI 数据分析 Azure 数据库 AI 应用和智能体 Microsoft 市场 Microsoft Sovereign Cloud AI 应用和智能体 Azure 的负责任 AI AI 基础结构 AI 数据分析 机器学习运营 (MLOps) Azure 上的低代码应用程序开发 集成服务 无服务器计算 DevOps 迁移和现代化中心 .NET 应用迁移 Azure 上的数据库 Linux on Azure Azure 上的 Oracle Microsoft 云上的 SAP 自适应云 高性能计算 (HPC) 基础结构即服务 (IaaS) 复原能力 Azure Essentials 适用于 Azure 的 Frontier Accelerate Azure 上的 FinOps Microsoft 市场 Azure 定价概述 创建 Azure 帐户 免费 Azure 服务 灵活的购买选项 定价计算器 Azure 上的 FinOps 最大限度地提高 AI 的 ROI Azure 节省计划 Azure 预留 Azure 混合权益 虚拟机 Azure SQL Microsoft Foundry Microsoft Fabric Azure Kubernetes 服务 (AKS) Microsoft Defender for Cloud 查看更多 软件开发公司 Microsoft 市场 寻找合作伙伴 面向 Azure 合作伙伴的资源 开始使用 Azure 客户案例 分析师报告、白皮书和电子书 视频 详细了解云计算 文件 探索 Azure 门户 开发人员资源 快速启动模板 面向初创企业的资源 开发者社区 学生 面向合作伙伴的 Azure 部落格 活动与网络研讨会 了解 支援 连络销售人员 开始使用 Azure 登录

什么是数据库分片?

数据库分片是一种水平缩放方法,可提高全球分布式系统的解决方案性能和可用性。

数据库分片定义

数据库分片是指将大型数据库划分为更小、更易于管理的段(称为分片)的过程。它支持水平缩放,以便应用程序和系统可以处理不断增长的数据和用户量,而不会影响性能或可用性。组织可使用分片策略来克服与在现代云环境中缩放数据库缩放有关的存储约束和其他挑战。

  • 数据库分片被定义为一种水平缩放方法,它可将数据库拆分为在无共享体系结构 (SNA) 上运行的独立分片。
  • 数据通过分片键在分片间分配,从而支持应用程序将请求路由到相应的分片。
  • 数据通常使用数值、哈希函数、查找目录或地理位置在分片之间划分。
  • 数据库分片的优点包括提高查询性能、支持水平可伸缩性和增强容错能力。
  • 分片用例包括银行业、电子商务和社交媒体平台,这些机构通常必须应对处理数据或用户的快速增长或激增。

数据库分片的工作原理是什么?

数据库分片是一种用于水平缩放大型数据库的技术,其方法是将大型数据库划分为较小的独立部分(称为分片)。每个分片作为单独的数据库运行,其中包含总体数据的独特子集,但维护相同的架构。通过此方式,即使分片在单独的服务器上运行,也可以共同形成单个逻辑数据库。

数据库分片遵循无共享体系结构 (SNA),这是一种分布式计算模型,其中每个分片独立运行,而无需与其他分片共享处理、内存或存储资源。

分片键(数据中的特定字段或字段组合)决定了每个分片上将会存储的数据。当应用程序需要读取或写入数据时,它使用分片键将请求路由到相应的分片。

分片策略

组织以不同的方式管理跨多个分片分布的数据。下面是一些常见的策略:

  • 基于范围或动态分片:按分片键中值的范围划分数据。例如,可以为电子商务数据库中的一个分片分配客户 ID 号 1-1,000,000,然后可为另一个分片分配客户 ID 号 1,000,001-2,000,000。此方法对范围查询非常有效,但如果比较频繁地访问某些范围,则可能会导致分布不均匀。
  • 基于哈希的分片:通过将一个名为哈希函数的数学公式应用于每个分片键,可以跨分片均匀分布数据。此方法有助于防止重载,但可能会将相关数据分散到多个分片,从而降低范围查询的效率。
  • 基于目录或基于查找的分片:分片映射指示分片键对应的数据。此策略提供了根据需要快速添加更多分片键的灵活性,但增加了复杂性和潜在的开销。
  • 异地分片:根据地理位置对数据进行分区,可减少不同区域中用户的延迟并支持数据驻留要求。许多平台将异地分片与数据库副本配对,以提高复原能力。

详细了解数据库

数据库分片的主要优势是什么?

数据库分片需要仔细选择分片键、分片策略以及查询路由优化。下面是数据库分片的一些主要优势:

  • 提高查询性能:通过跨多个分片分发数据,数据库可以更快地检索执行每个查询所需的数据集。此方式可以缩短响应时间。
  • 支持水平可伸缩性:组织可以通过横向扩展和添加更多分片(及服务器)来适应不断增长的数据和工作负载量,而不是在单个服务器上纵向扩展资源容量。详细了解纵向扩展与横向扩展
  • 增强容错:由于分片采用 SNA 方法,因此每个分片与其他分片相互隔离。影响一个分片的任何问题都不会影响其他分片,从而提高了系统可靠性。跨分片的数据复制可进一步保护可用性。
  • 提供成本效益:与大型数据库相比,数据分片的硬件和软件要求更少,而大型数据库通常需要昂贵的高端服务器。

帮助优化 AI 工作负载:复杂的单体数据库可以降低 AI 访问数据、进行预测和随时间推移持续学习的能力。分片支持创建分布式、数据丰富的环境,AI 可在其中更有效地运行。

数据库分片的行业特定示例

对于遇到数据或用户流量出现快速增长或峰值不可预测的基于云的解决方案,数据库分片尤其具有价值。以下用例演示了各行业中应用分片的方法:

  • 电子商务:零售平台可跨分片拆分客户和订单数据,以帮助确保在高峰购物期间提供快速进产品搜索和顺利结帐的体验。
  • 金融服务:银行和其他金融交易的记录按日期或帐号拆分,可实现高效查询和安全的可缩放存储。
  • 在线游戏:玩家或会话数据按区域和用户 ID 划分,可跨分片均衡负载,并在最大程度上降低全球受众的延迟(数据传输到目标所需的时间)。
  • 社交媒体:社交媒体平台可按用户 ID 或时间范围划分用户个人资料和活动源数据。借助此方法,平台可快速查询最近发布的帖子,并支持数百万并发用户。
  • 软件即服务 (SaaS):具有多个租户的 SaaS 应用通常按租户 ID 划分数据,这可以隔离客户数据,并随着用户群的增长简化管理。他们还可以按租户工作负载或地理位置划分数据。

详细了解大数据分析的工作原理。

数据库分片的未来

通过跨多个独立服务器分发数据,分片可以减少任何单个服务器上的负载,最大程度地减少瓶颈,并提高系统可用性和响应能力。在现代云环境中,使用数据库分片的优势只会随着 AI 和其他相关技术的不断发展日益提升。

值得关注的趋势包括:

AI 辅助的分片工作流

智能功能(如自动分片键选择、工作负载重新平衡和查询路由)将会变得更加主流。

优点:简化和优化的操作,以及前所未有的可伸缩性

零停机时间重新分片

现代数据平台将逐渐支持分片键更改,而无需任何数据停机时间或进行复杂的数据迁移。

优点:随着工作负载的发展,更灵活地更新分片策略

分片与无服务器数据库相结合

无服务器数据库独立预配和管理每个分片的服务器。它们还可根据事件驱动的查询按需纵向扩展或缩减容量。

优点:减少运营开销

自适应、策略驱动的地理分片

自动分片工作流根据代码中嵌入的特定于地理位置的策略规则,自动跨地理分片路由数据。优点:更快速地遵守不断变化的法规和隐私要求

详细了解云计算

常见问题解答

  • 数据库分片是跨多个服务器水平缩放大型数据库的过程,其中每台服务器均托管一个包含整体数据独特子集的分片。分片用于高效处理不断增长的数据量和用户流量,其方法是跨计算机分布查询和存储,而不是依赖于单台大型服务器。
  • 分片和分区都通过将大型数据库分解为较小的子集来优化数据库操作。但分区是在同一服务器上拆分数据,而分片则是跨多台服务器分布数据。复制是指跨不同服务器维护同一数据集的多个副本以实现冗余。 
  • 是,数据库分片可提高应用程序性能和可伸缩性。通过跨分片分发数据和工作负载,分片可减少查询响应时间并提高容错能力。组织还可以水平缩放应用。选择分片键和分片策略对于优化数据分片至关重要。
  • 是,Azure 和其他云平台为数据库分片提供了内置支持。例如,Azure SQL 数据库提供多种用于优化数据库缩放的工具,包括简化分片创建和管理的客户端库。