记录分布式系统、高并发架构、AI应用等领域的实践经验与技术思考。
在百度广告业务中,我设计开发了一套管理700+离线任务的分布式调度系统。本文详细讲解如何基于Zookeeper实现节点选主与主从切换、如何使用时间轮设计保证任务调度不丢失、如何将执行器与调度中心解耦并支持Docker上K8s云原生部署,以及在这个过程中踩过的坑。
蚂蚁国际ANTOM账单系统面临严重的数据倾斜问题,查询超时频发。本文分享如何设计新的分库分表规则彻底解决倾斜,如何基于ElasticSearch重构查询模块(5分钟到100毫秒),以及将账单从离线产出改为在线产出(T+1D到T+1H)的完整架构升级过程。
如何将MCP协议、远端知识库和AI Agent技术结合,构建面向商户的智能对账工具?本文从MCP Server的tool设计、知识库搭建、Skill封装SOP三个层面,分享AI自动化对账系统的完整技术方案和实践经验。
在百度分账分成引擎中,大事务导致的主从延迟一度达到分钟级,严重影响了下游系统的实时性。本文分析大事务产生延迟的底层原理(MVCC、binlog复制),以及我们采用的拆分事务、异步写入等优化策略,最终将延迟降至毫秒级。
作为NaviRPC的源码贡献者,我对RPC的底层机制有深入的理解。本文从服务发现、负载均衡、序列化、网络传输等核心模块出发,解析NaviRPC的实现原理,并探讨如何在实际项目中优化RPC调用性能。
从百度MEG最佳新人到蚂蚁superma提名,这六年走过了怎样的技术成长路径?分享我从初级到高级工程师的转变过程,包括技术深度的积累、架构思维的养成、AI时代的转型,以及对未来发展的规划。
如何设计一个支持异构数据源的自助查询平台?本文分享管道设计思想在流式计算中的应用,如何设计灵活的算子系统,以及如何实现跨库join和自动join功能,最终让80%的跑数需求由非技术人员自助完成。
作为Claude Code的深度用户,分享我在日常后端开发中使用Vibe Coding的工作方式。从代码生成、代码审查、Bug排查到架构讨论,探讨AI如何改变后端开发的工作流,以及哪些场景下AI特别有效、哪些仍需谨慎。
定期分享分布式系统、高并发架构与AI应用的技术文章,直接送到你的邮箱。