数据库小学妹_个人页

数据库小学妹
个人头像照片
174
0
0

个人介绍

设计小妹转行学数据库的第N天,记录我的数据库进阶之路,帮你少走弯路少踩坑!

擅长的技术

  • 关系型数据库
  • 数据库
获得更多能力
通用技术能力:

暂时未有相关通用技术能力~

云产品技术能力:

暂时未有相关云产品技术能力~

阿里云技能认证

详细说明
暂无更多信息

2026年09月

  • 09.30 16:18:11
    发表了文章 2026-09-30 16:18:11

    生产上跑着七个库|我把它们收进一个之后,账目变了

    从一次梳理出七个数据组件、六条同步链路的经历切入,先用跨模型混合过滤讲透"拆开之后"的召回与拼装代价,给出五笔代价清单、四个收敛判断维度、该收敛与仍该独立的两类场景边界,再拆解多模同库的资源争抢与三层隔离手段,最后用收敛前后对比表和分步迁移的回退路径收束。
  • 09.30 10:01:38
    发表了文章 2026-09-30 10:01:38

    用户投诉"改过的资料又变回旧的"|异地多活的写冲突到底怎么解

    从同城双活上线三个月的用户投诉切入,先分清容灾与多活、钉死"两个写入点必然产生冲突"这个前提,拆出写冲突的三种来源与可量化的冲突率统计,逐个拆解单元化、最后写入胜出、跨中心共识、冲突检测与合并四个方案的机制与代价,给出唯一性约束三种解法与自增号段的扩容陷阱,并配时钟漂移监控与会话粘性的避坑清单。
  • 09.29 16:02:46
    发表了文章 2026-09-29 16:02:46

    AI数据库的两个时间字段我漏了一个,Agent 的旧记忆盖住了新的

    从一次"Agent 记住了却用错"的真实故障切入,讲清 AI数据库做记忆底座时真正要过的两关:写入端的丢、重、乱序,和召回端只按相似度排序的三个坑。含幂等写入、带时效衰减与去重的召回 SQL,以及记忆的有效时间与写入时间的处理方法。
  • 09.29 10:08:03
    发表了文章 2026-09-29 10:08:03

    一条查询从50毫秒变340毫秒|分片键选错之后我才看懂架构选型

    从一次架构改造后查询变慢切入,按"写入点几个、数据切没切"分开三种架构形态,拆解缓存融合与多数派复制机制,对比各自的瓶颈位置,指出热点两条路线都解决不了,给出带量化指标的选型四步法。
  • 09.28 09:52:30
    发表了文章 2026-09-28 09:52:30

    2亿行降到8000万|我放弃分库分表,用分区归档解决了

    从接手 2 亿行订单表撞上查询慢、DDL 跑不完、备份窗口爆炸切入,先量热数据占比、写入增长、合规保留期三个数,再用时间分区 + 分区裁剪 + pt-archiver 分批归档 + 归档对账把存量清掉,并给出冷热分离三层架构与三个真实踩坑,最后说明归档是清存量、分库分表才是扩流量。
  • 09.24 10:06:12
    发表了文章 2026-09-24 10:06:12

    50毫秒变5秒|SQL没改计划却变了,锅在统计信息采样

    从一条日结 SQL 一夜之间慢了一百倍切入,拆解执行计划漂移的根因:InnoDB 统计信息靠随机采样、变更越阈值就重算、基数估不准、代价模型据此改选全表扫描。给出直方图、采样页数、重建统计等治本手段与索引提示的止血边界,并附三个避坑经验。
  • 09.23 09:59:25
    发表了文章 2026-09-23 09:59:25

    点一次末页卡20多秒|深分页试完五种解法我才想明白

    从运营点了一次列表「末页」卡住二十多秒切入,拆解 LIMIT 大偏移为什么慢、EXPLAIN 的 rows 为什么看不出来,再用覆盖索引与延迟关联、keyset 游标、解耦总数、产品层筛选、宽索引五种方案对比,最后给出该改 SQL 还是该改产品的分水岭判断。
  • 09.22 09:44:27
    发表了文章 2026-09-22 09:44:27

    库存100件卖了137件|拆完锁范围我才知道问题不在事务

    从一次大促超卖事故切入,拆解"先查后改"为什么会在并发下超卖、原子 UPDATE 的当前读与行锁原理、热点行的分桶拆解方案、Redis 预扣的一致性代价,以及隔离级别和索引类型如何影响锁范围,最后给出库存扣减的正确性优先顺序。
  • 09.21 10:03:31
    发表了文章 2026-09-21 10:03:31

    同一句SQL我却找不出慢在哪|拆完七段执行流程,答案在SQL之外

    从一次接口超时告警切入,把一条 SQL 在 MySQL 里的完整路径拆成七段(连接器、查询缓存、解析器、预处理器、优化器、执行器、存储引擎),用 optimizer_trace 和 Handler_read 变量判断慢在哪一段,并给出慢查询排查的顺序与三个避坑经验。
  • 09.18 14:23:11
    发表了文章 2026-09-18 14:23:11

    人点几十次,Agent 发几万次:数据库架构的四个改写

    AI Agent 正在成为数据库的主力访问者,它们高频、细碎、要求确定。本文用一个真实故障切入,拆解 Agent 时代数据库架构必须重写的四个地方——负载模型、权限接口、存储模型、治理模型,附对比表、决策框架与避坑清单。
  • 09.16 10:02:07
    发表了文章 2026-09-16 10:02:07

    对账差了三毛钱,查完我把全部金额字段从DOUBLE改成了DECIMAL

    一次财务对账差三毛钱的排查,牵出金额字段用浮点数的老坑。从IEEE 754为什么存不准0.1讲起,用同一批金额把FLOAT、DOUBLE、DECIMAL三种类型实测对比,再给出金额字段的选型、聚合与改表做法,附避坑清单。
  • 09.15 09:58:03
    发表了文章 2026-09-15 09:58:03

    大模型调用成本降62%?语义缓存的阈值与命中率实测

    客服机器人上线两周,用户问题高度重复,每次都走完整套RAG,数据库读QPS翻三倍,大模型账单飞涨。文章讲清语义缓存怎么用"向量相似度"代替"字符串相等"去命中重复提问,落地时数据该存哪、相似度阈值怎么定,以及多租户隔离、知识库更新失效、别缓存低质量回答这几个真正的难点。附两周实测:命中率约57%,大模型成本降约62%,命中时首字延迟从3.2秒降到0.45秒。
  • 09.14 10:06:17
    发表了文章 2026-09-14 10:06:17

    同一张表5000万行,随机UUID写入比自增慢3倍多?

    订单表5000万行,主键到底选自增还是UUID?从InnoDB聚簇索引的插入模型讲起:自增BIGINT为什么顺序写、省空间,UUIDv4的随机主键怎样引发页分裂和空间膨胀,再到既全局唯一又接近顺序写的UUIDv7。用同一套数据把三种主键各建一张表实测,对比写入耗时与表空间,给出分场景选型和老表改造的稳妥做法,也顺带看了金仓KES在行标识与分布式主键上的布局。
  • 09.11 09:54:39
    发表了文章 2026-09-11 09:54:39

    1万行插入13秒到0.9秒:ORM批量插入只差一个参数

    从一次列表接口慢的排障讲起,发现2000多条一模一样的N+1查询。文章拆开ORM生成慢SQL的三类典型病:N+1懒加载、逐条批量插入(只差一个rewriteBatchedStatements参数)、隐式转换让索引白建。给出JOIN/批量IN/@BatchSize的取舍、MyBatis与JPA各自的修法,以及用performance_schema按SQL指纹抓N+1、测试环境打印真实SQL的协作办法。
  • 09.10 09:50:38
    发表了文章 2026-09-10 09:50:38

    订单表上亿行,我按用户ID拆成128片之后怎么样了

    从单表几千万行慢查询的痛点出发,讲清垂直拆分与水平拆分的区别、分片键怎么选、分片算法(hash取模/range/一致性hash)怎么权衡,以及分库分表带来的分布式ID、跨片查询、分布式事务等问题,给出避免过度拆分的避坑清单。
  • 09.09 10:16:36
    发表了文章 2026-09-09 10:16:36

    AI写的SQL语法对、性能炸?上线前五道关卡能救命

    从AI生成SQL的三大翻车模式(字段幻觉、性能灾难、语义错误)出发,给出上线前五道审核关卡:结构预检、执行计划校验、高危操作拦截、灰度上线、审计追踪,附SQL示例与避坑清单。
  • 09.08 10:15:26
    发表了文章 2026-09-08 10:15:26

    高并发下1档只慢一点?innodb_flush_log_at_trx_commit的0/1/2实测

    生成图片:不要沿用上面的图片风格,重新生成 4 张文章封面图供我选择,16:9 主标题:MySQL持久性最佳实践 副标题:redo刷盘参数三档取舍与故障分析 文章概述:实测innodb_flush_log_at_trx_commit的0、1、2三档性能,讲清进程崩溃与断电下的丢数据边界,以及redo、doublewrite、双1的关系,给出选型建议。
  • 09.07 10:14:01
    发表了文章 2026-09-07 10:14:01

    一条UPDATE让订单表卡死40分钟,根因是Sleep了72分钟的那个连接

    一条中午就该提交的UPDATE,在事务里挂了70多分钟,整张订单表堵死40分钟。文章从processlist里不起眼的Sleep连接讲起,拆解MDL排队机制、lock_wait_timeout默认一年的坑、行锁与元数据锁两套超时的差异,以及RR隔离级别下长事务如何钉住purge水位线、让undo只涨不缩。最后给出commit与kill的判断标准,以及长事务监控与DDL变更的治理方法。
  • 09.04 16:18:00
    发表了文章 2026-09-04 16:18:00

    加索引写入TPS掉到1/3?订单表慢查询的五个反直觉真相

    以五个真实排障案例拆解MySQL慢查询的反直觉真相:type=index不等于快、索引会拖垮写入、LIMIT救不了深分页、大JOIN未必优于小查询、慢SQL常常是受害者不是凶手。主张收到慢查询先证明瓶颈,动索引前先做减法。
  • 09.04 10:09:36
    发表了文章 2026-09-04 10:09:36

    3个月AI Agent运维实测:慢SQL它管,根因还得我上

    以三个月实测的视角,划清AI Agent自治运维的真实能力边界:巡检、慢SQL发现等重复活已可替代,复杂根因、变更审批、数据兜底仍需人把关,探讨DBA角色从救火队员向定规则、把关人的转型。
  • 09.03 09:47:08
    发表了文章 2026-09-03 09:47:08

    面试总问的B+树,我把磁盘IO到底怎么算的讲清楚了

    从磁盘IO的底层约束讲起,逐层对比哈希、二叉、红黑树、B树与B+树,讲清MySQL为什么选B+树(矮胖树、顺序IO、范围查询、查询稳定),并用这套底层理解反过来指导覆盖索引、前缀索引、最左前缀等日常索引设计。
  • 09.02 09:54:40
    发表了文章 2026-09-02 09:54:40

    死锁报错看了三遍没看懂?我拆给你看(附定位SQL)

    从一次真实死锁现场切入,讲清行锁、间隙锁、插入意向锁的加锁机制与死锁形成原理,手把手教你怎么用show engine innodb status和information_schema定位死锁,并给出加锁顺序设计等避坑清单。
  • 09.01 09:58:54
    发表了文章 2026-09-01 09:58:54

    1TB库克隆从小时级到秒级,开发环境不再靠手搓

    从AI编程时代开发环境不够用的痛点出发,讲清数据库秒级克隆的底层原理(copy-on-write与写重定向两条路线、引用计数与垃圾回收的工程差异)、三种实现层次(逻辑复制/存储快照/数据库原生COW),结合Neon、TDSQL-C及金仓KES的布局,给出三种落地模式(按开发、按PR、给Agent)、配额回收权限三个管理要点,以及一次配额被打爆的真实复盘与避坑清单。

2026年08月

  • 08.31 10:06:58
    发表了文章 2026-08-31 10:06:58

    月账单从340美元到0美元?我把SaaS分析迁到了DuckDB

    从云数仓高额账单的痛点出发,讲清DuckDB嵌入式分析为什么火(列式存储+向量化执行+免ETL直查文件),划清它能替代谁、替代不了谁,结合行业降本案例给出适用边界判断与避坑清单。
  • 08.28 09:50:52
    发表了文章 2026-08-28 09:50:52

    从库延迟一小时,我排查到binlog才发现问题(附排查命令)

    从一次主从延迟的生产事故切入,讲清MySQL主从复制原理(binlog、relay log、三线程、同步模式),拆解Seconds_Behind_Master的坑与延迟定位方法,给出主从不一致的发现与修复流程和避坑清单。
  • 08.27 15:50:12
    发表了文章 2026-08-27 15:50:12

    同一句"是会员"Agent问了两遍?给记忆层一次搭明白

    从Agent反复失忆的现实问题出发,梳理上下文窗口与无状态会话两个根因,讲清短期、长期、团队三层记忆的存储设计与治理方法,用Redis和向量库实操演示记忆层搭建,给出异步写入、按人隔离、记忆清理等避坑清单。
  • 08.27 10:01:36
    发表了文章 2026-08-27 10:01:36

    一个存储过程改写,占了我一半的迁移时间

    从信通院2026数据库产业图谱与关键行业"AI数据库"攻坚计划说起,讲清国产数据库为何已完成外围替代、攻坚核心业务系统却最难,从兼容性、高可用、性能与生态四大卡点逐一拆解,结合一线去O迁移经验给出判断与避坑清单。
  • 08.26 10:37:20
    发表了文章 2026-08-26 10:37:20

    10分钟配置MCP,让AI Agent直接查你的MySQL

    从"AI Agent怎么访问数据库"这个现实问题出发,梳理Agent连库方式的演进,讲清MCP协议的原理与价值,用MySQL实战演示如何配置一个MCP Server,并给出权限、安全、审计上的注意事项与避坑清单。
  • 08.25 10:21:57
    发表了文章 2026-08-25 10:21:57

    找共同好友,递归CTE写16行,一条MATCH搞定

    关系型数据库开始原生支持图查询了。从SQL/PGQ标准首次进入数据库内核说起,讲清属性图与图查询的基本原理,用社交关系场景实操建图与MATCH查询,对比原生图数据库的真实差异,给出适合与不适合的场景判断和避坑清单,聊聊关系库能力扩展的边界。
  • 08.24 10:03:29
    发表了文章 2026-08-24 10:03:29

    上线第一周就拦下1条危险SQL:Agent连库四道防线

    从团队试点AI Agent做数据问答差点出事的真实经历出发,梳理Agent连数据库与传统用户连库的本质区别,拆解提示注入、误操作、查询风暴、敏感泄露四类风险,给出最小权限只读账号、高危SQL拦截、全链路审计、速率控制四道防线的实操方案与避坑清单。
  • 08.20 13:57:29
    发表了文章 2026-08-20 13:57:29

    同一查询,云平台6分钟GPU原生10秒:我拆了拆70倍的来源

    从WAIC 2026全球首款GPU原生认知数据库说起,拆解数据库性能瓶颈的本质、GPU原生与GPU加速的架构差异、"70倍性能"的提升构成,以及哪些场景真正受益、哪些需要冷静,给出从业者的独立判断。
  • 08.19 10:11:34
    发表了文章 2026-08-19 10:11:34

    压测前TPS 3000,调优后12000:我的MySQL压测实战复盘

    从一次大促前的数据库压测实战出发,完整梳理sysbench压测全流程:环境搭建、四种测试场景设计(OLTP读写混合/只读/只写/点查)、关键指标解读(TPS/QPS/延迟分位数)、常见压测误区排查,以及从压测结果反推配置优化的实操方法。
  • 08.18 09:58:28
    发表了文章 2026-08-18 09:58:28

    切换从32秒缩到10秒,MHA到InnoDB Cluster升级复盘

    从MHA停维护近十年、份额跌至12%的现实切入,完整记录从MHA一主两从升级到InnoDB Cluster的路径,含MySQL Shell建集群、Router切换、数据迁移与验证下线
  • 08.17 10:06:56
    发表了文章 2026-08-17 10:06:56

    读写混合TPS差六倍,PostgreSQL与MySQL架构差异实测

    从架构设计、索引实现、事务隔离、复制机制、运维体验五个维度深度对比PostgreSQL与MySQL,覆盖MySQL 9.0向量检索与PostgreSQL 17新特性,附权威基准数据和选型决策框架
  • 08.14 10:20:32
    发表了文章 2026-08-14 10:20:32

    磁盘98%告警,ibdata1占了320G:五个大户排查记录

    以凌晨磁盘告警事故切入,逐一排查binlog、InnoDB表空间、undo日志、临时表、慢日志五个磁盘大户,覆盖MySQL 8.0的undo表空间管理和TempTable引擎变化,附自动清理脚本与监控配置
  • 08.13 10:42:49
    发表了文章 2026-08-13 10:42:49

    误UPDATE清零十万条余额,47分钟靠binlog全量救回

    从一次误UPDATE全表清零余额的事故切入,解析binlog ROW格式的恢复原理,附mysqlbinlog精确时间点提取脚本,以及my2sql、lightning等8.0可用闪回工具的实战用法
  • 08.12 09:51:51
    发表了文章 2026-08-12 09:51:51

    命中率98%跌至23%,17条告警齐发:Redis缓存三大故障复盘

    从618促销缓存雪崩事故切入,深度解析缓存穿透、击穿、雪崩的底层机制、生产级防御方案与监控告警策略,附布隆过滤器实现和分布式锁代码
  • 08.11 10:10:49
    发表了文章 2026-08-11 10:10:49

    纯向量库架构上线两周出事故,我帮他们重构后发现了3个选型误区

    从一次生产事故出发,拆解向量数据库爆火的真实原因,深入底层索引机制和架构取舍,分析融合趋势。给从业者一个清醒的判断框架。
  • 08.07 10:18:18
    发表了文章 2026-08-07 10:18:18

    实测四大AI模型写SQL,表现差距不小

    基于2026年8月已公开的主流模型版本(GPT-5.5、Claude Opus 4.7、Qwen3、Kimi k2.6),实测四个真实业务SQL场景。深入分析基准测试与真实场景的鸿沟、SQL幻觉根因,从准确性、可读性、性能三维度给出量化测评。
  • 08.06 10:04:04
    发表了文章 2026-08-06 10:04:04

    CXL内存池化趋势:数据库架构师需要提前关注什么

    CXL 3.0开始送样,4.0规范已发布,内存池化正在成为现实。从缓冲池、缓存层到存算分离,聊聊这项技术会让哪些数据库架构受益,哪些被动挨打。
  • 08.04 10:54:14
    发表了文章 2026-08-04 10:54:14

    DBA凌晨查账单:每月5万的云数据库竟有一半在空转,我的六个优化动作和数据验证

    从一次真实的云数据库成本优化复盘出发,分享实例规格合理选型、冷热数据分层、存储压缩、弹性伸缩策略、清理历史数据、预留实例规划六个关键步骤,附优化前后的成本对比数据和操作要点。
  • 08.03 10:06:19
    发表了文章 2026-08-03 10:06:19

    查询从45秒降到0.3秒,存储从1.2TB缩到180GB:IoT时序数据选型复盘

    5万台IoT设备日增4.3亿行数据,MySQL三天崩溃的完整复盘。从写入模型、B+树瓶颈、Gorilla压缩原理对比时序库与关系型数据库的根本差异,含宽窄表重构SQL、冷热分离迁移策略、time_bucket查询优化,以及3条实战避坑经验。

2026年07月

  • 发表了文章 2026-09-30

    生产上跑着七个库|我把它们收进一个之后,账目变了

  • 发表了文章 2026-09-30

    用户投诉"改过的资料又变回旧的"|异地多活的写冲突到底怎么解

  • 发表了文章 2026-09-29

    AI数据库的两个时间字段我漏了一个,Agent 的旧记忆盖住了新的

  • 发表了文章 2026-09-29

    一条查询从50毫秒变340毫秒|分片键选错之后我才看懂架构选型

  • 发表了文章 2026-09-28

    2亿行降到8000万|我放弃分库分表,用分区归档解决了

  • 发表了文章 2026-09-24

    50毫秒变5秒|SQL没改计划却变了,锅在统计信息采样

  • 发表了文章 2026-09-23

    点一次末页卡20多秒|深分页试完五种解法我才想明白

  • 发表了文章 2026-09-22

    库存100件卖了137件|拆完锁范围我才知道问题不在事务

  • 发表了文章 2026-09-21

    同一句SQL我却找不出慢在哪|拆完七段执行流程,答案在SQL之外

  • 发表了文章 2026-09-18

    人点几十次,Agent 发几万次:数据库架构的四个改写

  • 发表了文章 2026-09-16

    对账差了三毛钱,查完我把全部金额字段从DOUBLE改成了DECIMAL

  • 发表了文章 2026-09-15

    大模型调用成本降62%?语义缓存的阈值与命中率实测

  • 发表了文章 2026-09-14

    同一张表5000万行,随机UUID写入比自增慢3倍多?

  • 发表了文章 2026-09-11

    1万行插入13秒到0.9秒:ORM批量插入只差一个参数

  • 发表了文章 2026-09-10

    订单表上亿行,我按用户ID拆成128片之后怎么样了

  • 发表了文章 2026-09-09

    AI写的SQL语法对、性能炸?上线前五道关卡能救命

  • 发表了文章 2026-09-08

    高并发下1档只慢一点?innodb_flush_log_at_trx_commit的0/1/2实测

  • 发表了文章 2026-09-07

    一条UPDATE让订单表卡死40分钟,根因是Sleep了72分钟的那个连接

  • 发表了文章 2026-09-04

    加索引写入TPS掉到1/3?订单表慢查询的五个反直觉真相

  • 发表了文章 2026-09-04

    3个月AI Agent运维实测:慢SQL它管,根因还得我上

正在加载, 请稍后...
滑动查看更多
正在加载, 请稍后...
暂无更多信息
正在加载, 请稍后...
暂无更多信息