技术项目精选
高频交易撮合网关
面向撮合场景重构的接入网关。用无锁环形队列替换原有的通道模型,配合内存池与批量刷盘,把 P99 延迟从 42ms 压到 6ms,同时支撑峰值 12.4 万 QPS。
Kubernetes 多集群调度平台
统一管理三地五个集群的工作负载编排平台。实现基于成本与时延的智能调度、跨集群故障自动切换,以及一套 GitOps 发布流水线,让业务团队自助发布。
实时协作文档内核
基于 CRDT 的多人实时编辑内核,解决弱网环境下的编辑冲突与光标同步。自研增量快照机制,让万字文档的冷启动加载时间控制在 300ms 以内。
kubectl-lens 开源插件
一个把集群资源关系可视化到终端的 kubectl 插件。支持依赖链追溯、异常资源高亮与一键诊断,被多家公司纳入内部运维工具箱。
关于 陈亦舟
我相信优秀的基础设施应该是"无感"的:业务团队不需要理解它,就能安全地跑得很快。
我的职业主线是**高可用后端系统**。从最初维护一个日均百万请求的订单服务,到现在负责一整套跨三地机房的容器调度与流量治理平台,我处理过的问题基本都指向同一件事——如何在资源、延迟与成本之间找到当下最优解。
技术选型上我偏保守但不守旧:核心链路用 **Go** 保证可预测的延迟,性能敏感的编解码模块用 **Rust** 重写,工具链和内部平台前端则用 **TypeScript + Next.js** 快速迭代。我不追求技术栈的新鲜度,只关心它能否被团队长期维护。
除了写代码,我花大量时间在**可观测性**与**故障演练**上。团队现在的每一条核心链路都有对应的 SLO 定义、告警分级和演练脚本。过去一年,P0 级事故从 4 起降到 0 起,平均故障恢复时间(MTTR)从 47 分钟压缩到 8 分钟。
业余时间维护两个开源项目,并在公司内部主持每两周一次的架构评审会。我享受把复杂概念讲清楚的过程——这也是我判断自己是否真正理解一件事的标准。
能力矩阵
经历年表
高级后端工程师 · 基础设施组 @ 某头部金融科技公司
负责交易链路的性能优化与容器平台建设,带领 5 人小组支撑全公司的发布与运行时治理。
后端工程师 @ 某综合电商平台
负责订单与库存中台,处理大促场景下的高并发与数据一致性问题。
软件工程师(校招) @ 某云计算服务商
参与对象存储控制面开发,从这里开始建立对分布式系统的第一手认知。
计算机科学与技术 · 硕士 @ 国内某 985 高校
研究方向为分布式存储一致性协议,毕业论文获评院级优秀。
我能为团队解决的三类问题
高并发系统架构
面向高吞吐、低延迟场景的服务拆分、缓存策略与一致性方案设计。
- 分库分表与读写分离
- 多级缓存与热点探测
- 分布式锁与幂等设计
- 限流熔断与优雅降级
云原生基础设施
以 Kubernetes 为核心的容器平台建设,兼顾资源效率与交付速度。
- 多集群调度与容灾切换
- GitOps 发布流水线
- Istio 流量治理
- 成本可视化与弹性伸缩
可观测性与稳定性
把"能不能发现问题"变成一套可度量、可演练的工程能力。
- SLO 体系与告警分级
- Trace / Metric / Log 三支柱
- 混沌演练常态化
- 故障复盘与知识沉淀
教育经历
GPA 3.8/4.0,校 ACM 集训队,连续三年一等奖学金,毕业设计获评优秀。
研究方向为分布式系统与可观测性,参与国家级科研课题,发表 CCF-B 论文一篇。
项目 / 成果
面向撮合场景重构的接入网关。用无锁环形队列替换原有的通道模型,配合内存池与批量刷盘,把 P99 延迟从 42ms 压到 6ms,同时支撑峰值 12.4 万 QPS。
统一管理三地五个集群的工作负载编排平台。实现基于成本与时延的智能调度、跨集群故障自动切换,以及一套 GitOps 发布流水线,让业务团队自助发布。
基于 CRDT 的多人实时编辑内核,解决弱网环境下的编辑冲突与光标同步。自研增量快照机制,让万字文档的冷启动加载时间控制在 300ms 以内。
一个把集群资源关系可视化到终端的 kubectl 插件。支持依赖链追溯、异常资源高亮与一键诊断,被多家公司纳入内部运维工具箱。