上个月帮客户做双活选型。核心交易系统要替换Oracle,数据量不大,两三百G。客户提了三个要求。两个机房同时对外服务,故障切换不能丢数据,容量要撑五年。供应商给...
上个月帮客户做服务器迁移,数据库大概两百万条数据。当时觉得mysqldump一把梭就完事了。结果导出的SQL文件1.2G,导入新库跑了一整晚还没跑完。CPU直接...
去年数据中台项目,MySQL、Oracle、国产库并存。我拍着胸脯跟同事保证:DBeaver一个窗口全管。结果连MySQL一分钟,连国产库折腾一下午,甩出一行报...
你一定听过这句话:“能不用子查询就不用,改成JOIN就快了。”但在MySQL 5.6+的环境下,这个说法已经不完全成立了。很多IN子查询,优化器会自动转成半连接...
去年,某能源集团的核心交易系统在业务高峰期遭遇了一次“惊魂时刻”——并发请求突破特定阈值后,单机架构的锁竞争导致响应延迟从50ms飙升到3秒以上,系统触发熔断,...
十五年数据库相关经验,做过 DBA、架构师、技术顾问。不求"颠覆",只求"靠谱"。
从库延迟了,读请求开始堆积;堆积的读请求占用从库资源,拖慢回放;回放变慢,延迟进一步增加;延迟增加,更多读请求堆积……形成了一个恶性循环。一次大事务,可能把整个...
去年10月,一个水利行业的老客户找上我。他说GIS系统要信创改造。Oracle Spatial里存了十几年管网,空间对象上千万个。业务方丢下一句"换个库而已",...
上周三凌晨三点零二分,主库10.0.0.1无响应,MHA自动切换,32秒后新主库上线,应用重连恢复。切换很成功,但我盯着监控屏却高兴不起来。因为心里清楚,MHA...
数据库迁移这件事,说起来不就是"把数据从 A 搬到 B",但真正干过的人都知道:从评估到割接,一步走错就是生产事故。
全量迁移时源库还在持续写入、增量同步时事务顺序可能错乱、异构数据库的日期精度可能丢失——这些问题,在POC阶段很难暴露,一上生产就变成事故。
灵光平台让用户通过一句话就能生成一个“闪应用”——记账本、报名页面、打卡工具、调查问卷……目前已经承载了约3000万个这样的应用。
做DBA久了,你一定会遇到这种情况:一张表有十几个索引,一半是重复的。一个存储过程两千行,改了三个月不敢动。数据库迁移评估下来,发现80%的工作量在“处理历史包...
传统“服务器+存储+数据库软件”的分离架构中,任何一个环节的短板都可能成为整个系统的瓶颈。当存储I/O成为数据库的拦路虎时,单纯调优软件参数往往效果有限。
缓存是扛高并发的利器,但缓存不是"上了就稳了"。用不好,三个经典问题轮流轰炸你:穿透、击穿、雪崩。
上个月凌晨,一个做技术负责人的朋友给我打电话,声音都是抖的。他们公司半年前拍板换数据库产品,图便宜选了个小众产品。结果上线不到两周,核心交易系统每天卡死两三次,...
半夜两点,告警短信炸了。你打开监控,CPU 85%——报警了。但你看了半天也看不出来,为什么85%要报警?这个阈值是谁设的?设的时候有什么依据?你改到90%,安...
上个月做交通数据平台的朋友找我,说空间数据库上线两周后,"查某条道路附近500米内的监控点位"这个查询从47毫秒变成6秒多。加了内存、升了CPU都没用,重启数据...