PolarDB Limitless助力MiniMax构建海量长周期记忆的数据底座

简介: MiniMax(稀宇科技)是全球领先AI公司,自研全模态大模型,推出海螺AI、星野等产品。面对星野平台海量多模态数据、潮汐流量与高成本挑战,其基于阿里云PolarDB Limitless构建智能数据底座,实现千亿级对话表性能提升3倍、秒级弹性扩缩容、存储成本降75%,支撑2.36亿用户高效服务。

1. MiniMax简介

MiniMax(稀宇科技)是全球领先的通用人工智能科技公司,成立于2022年,以“Intelligence with Everyone”为愿景,致力于推动人工智能科技前沿发展。MiniMax 坚持文本、视频、语音全模态自研。基于自研全模态模型,MiniMax 面向全球推出一系列 AI 原生产品,包括海螺AI、星野、Talkie等,以及面向企业和开发者的开放平台。迄今已有超过200个国家及地区的逾2.36亿名用户,以及来自超过100个国家及地区的企业客户以及开发者。


2. 海量数据下的业务挑战和解决方案

2.1 业务挑战

星野是MiniMax基于多模态AIGC技术构建的AI智能体创作平台,通过文本、语音、视频等多模态交互,支持用户定制具备个性化形象、声线、人设及技能的AI角色。其核心价值聚焦于对话场景,依托自研大语言模型的上下文感知与表达能力,实现高拟人化对话驱动,构建用户与AI角色间的持续互动关系。星野的用户规模与用户活跃度一直位居领先地位,并且仍在持续不断增长,这也给支撑其多模态对话数据的底层存储带来了诸多技术挑战:


▶︎ 海量多模态数据的存储与性能瓶颈

  • 涉及用户自定义AI角色模板、对话数据,及视频、音频、图像等非结构化内容数据,日均新增数据达数亿条,整体规模已超过百TB级别,并呈指数级增长;
  • 传统数据库在处理包含数十MB JSON或Blob的大字段时性能急剧下降,尤其在表大小超过10亿行后,读写延迟显著上升,直接影响AI推理链路效率。

▶︎ 潮汐流量下的弹性与稳定性压力

  • 业务流量呈显著潮汐特征,峰值并发请求量相比日均基线负载扩大10倍以上;
  • 静态资源配置模式导致低谷期资源闲置、TCO显著上升,而高峰期因数据库水平扩展能力受限,引发数据处理性能衰减、端到端响应延迟增加,严重影响服务稳定性和用户体验。

▶︎ 架构边际成本持续攀升

  • 随着业务规模的指数级增长,计算、存储、运维成本持续上升,现有架构的边际成本逐步增加,成为可扩展性的主要瓶颈。


2.2 MiniMax基于PolarDB的智能数据底座实践

1.1.png

MiniMax基于PolarDB Limitless的大模型数据底座


(1) 分布式多主架构:支持海量对话数据处理

MiniMax借助PolarDB Limitless的分布式多主集群架构,打破了传统单主节点的性能瓶颈。该架构支持高达63个计算节点的同时写入,使得每日新增的xTB级对话数据可以被高效地分散到多个Shard上,实现了写入吞吐量的线性扩展。


此外,分布式DDL能力允许MiniMax在不中断服务的情况下进行表结构变更。PolarDB支持在不影响在线业务的前提下通过多阶段提交协议确保跨节点表结构变更的原子性,业务团队无需停服维护即可完成表结构变更,大幅加快产品迭代速度。


2.2.png MiniMax PolarDB Limitless集群技术架构图


(2) 秒级弹性扩缩容:灵活应对流量变化

面对流量潮汐,MiniMax 采用了 PolarDB 的 Serverless 弹性扩缩容功能。通过实时监测PolarDB的CPU/内存负载,系统可在 5 秒内完成预测,并在 1 秒内完成从 0 到千核的无感扩容,最大可支撑十万级突发 QPS 冲击。


MiniMax 基于 PolarDB 的 PolarStore 共享存储架构,实现了“零数据拷贝”的弹性扩缩容:扩容仅需切换分区的计算所有权,无需迁移物理数据;结合智能分区调度算法,元数据与状态迁移量减少 30%–50%。整个过程保障连接不中断、事务不丢失、性能波动低于 5%,对业务完全透明。由此,MiniMax 无需为峰值流量预留冗余资源,实现按需伸缩,整体计算成本降低 50%。


(3) 大表与大字段优化:加速长上下文处理

针对含大 JSON/Blob 字段的千亿级对话表,MiniMax 利用 PolarDB 的列存布局与局部更新能力,结合 RDMA 网络加速,实现单节点 12GB/s 的大字段吞吐,CRUD 性能提升超 3 倍,历史对话检索延迟稳定在毫秒级。同时,基于协程调度与上下文缓存的异步执行框架,使“按用户 ID 拉取对话流”等高频点查 QPS 提升 50% 以上,高效支撑 AI 推理场景。


3.3.png

大表大字段优化上下文性能


(4) 智能化数据底座:驱动业务规模化增长的引擎

MiniMax 将依托 PolarDB 冷热数据智能分离与多模态统一引擎的双轮驱动,构建高效能的智能化数据底座。在存储层面,可基于访问热度的自动分层策略实现了零代码改造下的成本极致优化,以毫秒级热数据响应与秒级冷数据检索,平衡 AI 实时交互与深度分析需求;在计算层面,借助原生 PolarDB 多模态引擎与 RDMA 高速网络,可实现文本、语音、图像等跨模态数据的低延迟高精度召回,显著增强 Agent 的长期记忆与上下文理解能力。这一兼具极高性价比与无限扩展性的架构,为 MiniMax 在海量并发场景下的业务快速迭代与规模化扩张提供了坚实支撑。


2.3 业务收益

目前,MiniMax 全系产品(包括海螺、星野、Agent、开放平台等)的100+数据库已经部署在 PolarDB 上,实现用户体验和开发效率的双重提升:

  • 高性能千亿级对话表读写性能提升超 3 倍,支撑日均数亿消息的实时写入与毫秒级检索;
  • 高弹性秒级无感扩缩容应对 10 倍流量波动,计算资源成本降低 50%;
  • 低成本冷热数据自动分层归档,存储成本下降 75%,运维人力减少 80%;
  • 快迭代分布式 DDL 支持 7×24 在线 schema 变更,AI 功能上线周期显著缩短。


未来展望

通过深度应用 PolarDB 的分布式多主(Limitless)、多模态存储、秒级弹性与智能冷热分层等核心能力,高效支撑了 MiniMax 大模型推理场景下高并发、低延迟、海量异构数据管理的技术挑战。不仅显著优化提升了用户体验、业务敏捷性与运维效率,更深刻验证了云原生数据库与 AI 系统深度融合的价值。随着 PolarDB “湖库一体”的智能数据底座与 MiniMax 的算法引擎协同工作,一个具备长记忆、多模态交互及实时响应能力的 AI 智能体生态得以规模化落地。


展望未来,阿里云数据库将与 MiniMax 持续深化合作,共同探索 AI 原生数据库的创新边界,打造 AI 多模态数据底座,加速大模型应用向更智能、更可靠的方向演进。

目录
相关文章
|
2月前
|
人工智能 关系型数据库 分布式数据库
阿里云数据库 AI 加速季火热开启!—— Agentic Native 的瑶池数据库释放数据潜能,畅享超值优惠!
阿里云数据库6月特惠:明星产品低至3折,赠1728元礼包!DB for AI原生向量引擎、PolarDB国产自研库、RDS/ClickHouse等AI能力全面升级,免费试用+专属折扣同步开启(6.1-6.30)→速戳活动页!
|
存储 消息中间件 Kafka
ClickHouse 23.8 (LTS) 版本发布说明
以下是ClickHouse 23.8 (LTS) 版本一些亮点功能...这次发布涵盖了向量的算术运算、tuple的连接、cluster/clusterAllReplicas的默认参数、从元数据中计数(对于Parquet来说速度提高了5倍)、文件内跳数(对Parquet有巨大提升)、从对象存储中流式消费数据,等等
|
6月前
|
存储 关系型数据库 分布式数据库
阿里云PolarDB PolarStore获得顶会 FAST'26 最佳论文提名
阿里云瑶池数据库PolarStore团队论文《PolarStore: High-Performance Data Compression for Large-Scale Cloud-Native Databases》获得顶会 FAST'26 最佳论文提名(全球仅5篇)。
阿里云PolarDB PolarStore获得顶会 FAST'26 最佳论文提名
|
5月前
|
SQL 人工智能 自然语言处理
我用DataClaw打造了一个7X24小时的数据助理
阿里云DMS DataClaw是7×24小时AI数据助理,支持自然语言提工单、智能巡检、多任务编排、SQL风险预审等9项硬功能,原生集成DMS安全体系,覆盖MySQL/Oracle等60+数据源。现在可免费试用,快来体验吧。
1156 10
|
19天前
|
存储 人工智能 关系型数据库
千问背后的记忆引擎:PolarDB-X Mem0
阿里云PolarDB-X分布式数据库,作为夸克与千问APP“长记忆”核心底座,支撑流量暴涨100倍、峰值20万TPS,具备海量弹性扩展、统一向量+结构化存储、强一致高可用及全球低延迟能力。其推出的全托管服务Mem0,一体化融合语义与业务记忆,降本50%,助力AI实现长期、安全、有温度的连续交互。
123 0
千问背后的记忆引擎:PolarDB-X Mem0
|
21天前
|
SQL 关系型数据库 MySQL
一库支持标量+向量+全文检索?阿里云 PolarDB 云原生数据库多模检索能力详解
有没有数据库能同时支持标量、向量、全文检索?阿里云 PolarDB 是这一需求的首选方案。一库多模,一条 SQL 完成混合检索,向量召回率 >99%,全文检索提速 33 倍,混合查询延迟 <8ms,架构复杂度降低 67%。如果你的业务正在面临多库拼接的复杂性和延迟瓶颈,推荐访问 阿里云 PolarDB 官网 体验多模检索能力或申请免费试用。
100 0
|
存储 人工智能 JSON
OpenClaw-Observability:基于 DuckDB 构建 OpenClaw 的全链路可观测体系
为解决OpenClaw等AI Agent“Done”回复背后的黑盒问题,我们基于DuckDB开发了轻量可观测插件:通过Hook采集关键节点事件,建模为结构化Trace链路,异步写入本地或云上DuckDB,提供瀑布图式执行视图、指标分析与安全告警,让Agent从不可见变为可追踪、可解释、可优化。
|
2月前
|
关系型数据库 Serverless 分布式数据库
万小智基于PolarDB Supabase一键AI建站,资源成本直降666倍
万小智是阿里云面向中小微企业的AI建站平台,支持“零代码、一分钟生成全栈应用”。为突破Supabase单租户架构的成本瓶颈,其联合PolarDB打造多租户+全链路Serverless方案:基于Schema沙箱隔离、四平面安全管控与秒级弹性伸缩,实现2000租户/集群、成本直降666倍,兼顾强隔离、低成本与开发者体验。
|
存储 人工智能 安全
智存跃迁,阿里云存储面向 AI 升级全栈数据存储能力
一文总览阿里云存储产品创新与进展!
1760 0
|
运维 算法 机器人
阿里云AnalyticDB具身智能方案:破解机器人仿真数据、算力与运维之困
本文将介绍阿里云瑶池旗下的云原生数据仓库AnalyticDB MySQL推出的全托管云上仿真解决方案,方案采用云原生架构,为开发者提供从开发环境、仿真计算到数据管理的全链路支持。