归档
共 203 篇文章
8月
日采 TB 级日志,Kafka 零拷贝和 ES 直写到底差多少资源?我们跑了一周实测
Sentinel 集群限流 Token Server 挂了,我们在控制台侧做了本地降级,压测数据验证了容灾效果
我在 gRPC 拦截器里把重试、超时、熔断串成一条链,业务代码终于不用再贴满重复的容错片段了
你的 UI 测试脚本是不是也写了一堆 findElement 然后改版就全崩
从延迟、积压、分区倾斜三个指标反推 Pulsar 容量规划,比盯着 CPU 内存管用得多
同一套压测场景,滑动窗口和令牌桶在突发流量下的延迟分布差了一个数量级
RocketMQ 顺序消息靠分区有序,真碰上需要全局强顺序的业务,加个业务层序号成本到底高多少
BEST 实测了 Kafka MirrorMaker 和 Pulsar 异地复制的容灾切换时间,RPO 的差距比预想的大
排查缓存问题我一般就靠慢查询、热 Key 分析和命中率曲线这三板斧,基本能把事故现场还原出来
模拟 Redis 挂了、数据刚好过期、100 个请求同时打进来,这套单元测试怎么搭
Kafka 的 Exactly-Once 语义听着很美,在跨系统场景下我还是老老实实上了业务去重表
查缓存没命中就全砸到库上,连接池满了怎么办?我用 CompletableFuture 把重复请求合并了一下
缓存预热搞不好比冷启动还慢——三种加载策略的耗时曲线和雪崩风险,压测数据摆出来聊聊
IoT 消息队列选型,我把 MQTT 和 AMQP 丢到弱网里跑了一组对比数据
康威定律之下:我们拆服务前先调了组织,结果跨团队协作还是掉了链子
跨服务日志里 traceId 断了,排查时用这几种传参和存储方式把它接上
缓存命中率跌到多少该告警?我们反过来用空值率和穿透量推了一把阈值