3000万个应用共享一套数据库:多租户“逻辑表”架构是如何做到的?

简介: 传统的“每个应用一张物理表”会导致物理表数量爆炸,“所有数据塞一张大表”又会让SQL计算能力失效。OceanBase用“逻辑表”架构解决了这个问题——每个应用拥有独立的表结构体验,但底层3000万个逻辑表共享同一套物理存储。本文从技术架构角度,拆解这套多租户“逻辑表”方案的实现原理。

大家好,我是小耶,写功课只是为了我踩过的坑,你们别再踩了!

8月初,OceanBase首次公开了支撑蚂蚁灵光AI生成应用的数据架构实践。

灵光平台让用户通过一句话就能生成一个“闪应用”——记账本、报名页面、打卡工具、调查问卷……目前已经承载了约3000万个这样的应用。

3000万个应用,每个都需要独立的数据存储和查询能力。如果是传统架构,要么为每个应用创建独立的物理表——物理表数量爆炸;要么把所有数据塞进一张大JSON表——SQL计算能力直接失效。

OceanBase给出的答案是:逻辑表

一、传统方案的两难困境

方案一:每个应用一张物理表

每个闪应用独立建表——3000万个应用就有3000万张表。数据库的元数据管理压力巨大,表数量爆炸会导致系统表膨胀、DDL操作缓慢、备份恢复时间急剧增加。

方案二:所有应用共用一张大表

把所有应用的数据塞进一张大表,用app_id字段区分。SQL引擎需要处理海量数据,查询时必须扫描全表再过滤app_id,索引效率极低。当单个应用数据量增长时,还会影响其他所有应用的查询性能。

两条路都走不通。灵光需要的是一套“中间方案”——应用层感觉独立,底层共享存储。

二、逻辑表架构的核心设计

逻辑表 vs 物理表

每个“闪应用”在操作层面仍然拥有独立的表结构——可以建表、插入数据、执行SQL查询,和使用独立数据库的体验完全一样。

但底层并不为每个应用创建独立的物理表。逻辑表是对物理存储的抽象映射。用户看到的是“我自己的表”,数据库底层看到的是“共享物理存储上的一个逻辑分区”。

JSONTable SDK

应用层通过JSONTable SDK与数据库交互。用户对逻辑表的操作(建表、插入、查询)被SDK转化为对共享物理存储的操作——数据以JSON格式写入底层物理表,读取时再映射回用户感知的逻辑表结构。

受控SQL计算

当用户执行SQL查询时,SQL引擎会自动注入租户隔离条件——每个查询只看到属于自己租户的数据,不会“越界”看到其他应用的数据。权限隔离在数据库内核层面完成,不需要应用层额外处理。

三、与传统多租户方案的区别

传统的多租户方案通常有两种做法:

  • 独立数据库:每个租户一个数据库——资源浪费严重,管理成本高

  • 共享数据库+租户字段:所有租户一张表,用tenant_id区分——查询需全表扫描,隔离性差

OceanBase的逻辑表方案走的是第三条路:

  • 操作层独立:每个应用看到的是自己独立的表结构,可以建表、插数据、执行SQL,体验跟独立数据库一模一样

  • 存储层共享:底层不创建独立的物理表,所有逻辑表共享同一套物理存储

  • 隔离层内建:多租户的权限隔离在数据库内核层面天然保障,不需要应用层额外处理

这种设计解决了两个核心问题:物理表数量不再随应用数量线性增长,存储成本大幅下降;多租户的权限隔离也天然得到保障。

四、为什么这套架构值得关注?

这不是一个“技术概念”,而是一个已经在生产环境验证的架构。3000万个应用跑在同一套数据库上,验证了逻辑表方案在真实场景下的可行性。

它反映了一个更大的趋势:数据库正在从“面向人”走向“面向AI Agent”。当AI可以批量生成应用,数据库面对的已不再只是容量和性能问题,而是被Agent持续生成的海量动态数据空间。每一个AI生成的应用都需要独立的数据能力,传统“一个应用一个数据库”的模式已经无法支撑。

五、总结

多租户“逻辑表”架构的本质,是在“应用独立”和“资源共享”之间找到了一个平衡点:

  • 每个应用拥有完整的SQL体验

  • 底层共享一套物理存储

  • 3000万个应用共享一套数据库

  • 某个应用增长到足够大时,可以一键迁移到独立的物理表

这套架构的价值不在于“多租户”本身,而在于它证明了:当数据规模从“人”的尺度变成“Agent”的尺度时,数据库架构需要被重新设计。逻辑表方案提供了一个可扩展的路径——让AI生成的应用从一开始就拥有独立的数据能力,而不用等到规模大了再重构。

小耶在手,SQL 不愁

还有什么想了解的,欢迎留言!小耶一定知无不言言无不尽……我们下次见~

相关文章
|
9天前
|
存储 弹性计算 缓存
阿里云服务器租赁费用:新版租赁收费标准及活动报价参考
本文更新了2026年阿里云全系列云服务器租赁活动报价,所有特惠资源均可前往阿里云活动中心选购,整体覆盖从个人入门到企业级高性能场景的全梯度需求。其中轻量应用服务器主打极致性价比,2核2G峰值200M带宽配置每日10点、15点限时抢购价仅38元/年,2核4G配置379元/年起;高性价比的经济型e实例、通用算力型u2i实例覆盖2核4G至4核32G全档位,适配开发测试与中小型企业业务;搭载英特尔至强6处理器的第九代c9i企业级实例算力较上代提升20%,支撑高并发生产环境,不同实例规格价差清晰,用户可根据自身业务负载与预算灵活选型。
1875 119
阿里云服务器租赁费用:新版租赁收费标准及活动报价参考
|
10天前
|
人工智能 程序员 API
Codex 接入 DeepSeek-V4-Flash:还能补上识图,提供两套方案
Codex 接入 DeepSeek-V4-Flash 怎么配?本文覆盖 CLI 与桌面端,再用 qwen3-vl-flash 补识图,两套方案可直接照做
1435 13
|
16天前
|
云安全 人工智能 运维
阿里云联动百位企业安全专家,共识Agent防御最佳实践
当Agent成为新员工,你的安全边界在哪里?
1964 10
阿里云联动百位企业安全专家,共识Agent防御最佳实践
|
7天前
|
编解码 弹性计算 云计算
MiniMax-H3 视频生成模型 — 一键部署与使用指南
MiniMax-H3是MiniMax开源的33B全模态视频生成模型,支持文生视频、图生视频、参考生视频三种模式,原生输出2K/15秒带立体声音频视频,已原生适配ComfyUI,并可通过阿里云计算巢一键部署。(239字)
|
10天前
|
人工智能 JSON Shell
2026AI漫剧本地全开源方案(附各个软件模型链接),8G显卡也能流畅运行
这是一套完全本地化部署的AI漫剧生成技术链路:涵盖LLM剧本分镜生成、FLUX文生图(IP-Adapter人脸锁定)、StoryDiffusion时序连贯控制、LTX-2.3唇形同步视频生成,及ComfyUI全流程调度。零云端费用,仅耗硬件算力,单集2–4小时可产出竖屏短视频,适配抖音/B站分发。
|
8天前
|
人工智能 API 开发工具
2026 零基础本地 AI 漫剧完整实操教程(8G 笔记本显卡可用|附可直接复制命令与代码)
本方案提供完全离线、本地运行的漫剧全自动制作流程:RTX3060/4050 8G显卡即可驱动,涵盖Qwen写分镜→ComfyUI统一角色绘图→LTX2.3图生微动画→Qwen3-TTS本地配音→FFmpeg自动合成,全程无水印、免API、不限次。专为低显存优化,解决变脸、闪烁、爆内存三大痛点。(239字)
|
22天前
|
人工智能 前端开发 Linux
Codex 桌面版安装 + CC Switch 接入第三方 API 完整教程(2026 最新)
2026最新教程:手把手教你安装Codex桌面版,通过CC Switch v3.17.0一键接入Fenno等国产API(兼容OpenAI Responses格式),跳过账号登录,完整启用代码审查、多步任务与上下文感知功能。零基础友好,全程图文实操。(239字)
3377 5
|
9天前
|
编解码 人工智能 安全
2核4G/4核8G/8核16G阿里云服务器如何选择实例?经济型e、通用算力型u2i与计算型c9i选哪个?
本文介绍了阿里云2核4G、4核8G、8核16G三档主流配置下经济型e、通用算力型u2i和计算型c9i三种实例的最新活动价格与适用场景。同配置下三者价差显著,以2核4G为例,经济型e低至599.93元/年,计算型c9i则高达1742.08元/年。文章详细解析了各实例的性能定位:经济型e适合轻负载入门场景,u2i兼顾稳定算力与性价比,c9i凭借第9代至强处理器与芯片级安全能力支撑高性能业务。同时提示用户可叠加满减优惠券享受折上折,建议根据业务负载与预算综合决策。
555 113