我目前在一家做实时数据管道的公司负责存储与调度层。日常是给一个每天吞吐数十亿事件的系统做容量规划、写 Go 服务、以及在 Rust 里重写那些 profile 之后发现真的很烫的路径。
比起追新框架,我更在意可观测性、明确的失败语义,以及一份让接手的人五分钟就能上手的 README。我相信大部分线上事故的根因不是技术难题,而是没有人把边界条件写下来。
不写代码的时候,我在维护一台跑了六年的家庭服务器、给开源项目提 issue,以及试图证明手冲咖啡的萃取时间和构建时长之间存在负相关。
一个嵌入式的变更数据捕获库。直接读 PostgreSQL 的逻辑复制槽,把行变更以背压安全的方式推给下游,单进程稳定跑到 12 万行/秒。
→把 SLO 定义、错误预算和告警规则写成一份 YAML,自动生成 Prometheus 规则与 Grafana 面板。目的很简单:让「还剩多少预算」这个问题有唯一答案。
→一个教学用的 Raft 实现,配一套确定性网络模拟器:可以在几秒内重放上万种分区与乱序场景。写它是为了自己彻底搞懂选举活锁。
→我的全部机器配置:三台服务器、两台笔记本,一份 flake。重装系统到能正常干活,耗时 11 分钟。
→2025-09-08 至 2026-09-08 · 跨 23 个仓库