返回首页本学科首页
Software Engineer / Infra

把复杂系统拆解成可靠的秩序

六年后端与基础设施经验,专注高并发交易系统、Kubernetes 多集群治理与可观测性建设。习惯用工程化手段消除不确定性——从一次线上故障复盘,到一套自动化发布流水线。

深圳 · 可远程
6 年工程经验
开放新机会
陈亦舟

陈亦舟

高级全栈工程师 · 基础设施方向
开放交流 · OPEN
12.4
峰值 QPS
99.99%
服务可用性
3.2k
GitHub Stars
64%
发布耗时下降
// WORKS

技术项目精选

12.4
峰值 QPS
99.99%
服务可用性
3.2k
GitHub Stars
64%
发布耗时下降
ABOUT

关于 陈亦舟

我相信优秀的基础设施应该是"无感"的:业务团队不需要理解它,就能安全地跑得很快。

我的职业主线是**高可用后端系统**。从最初维护一个日均百万请求的订单服务,到现在负责一整套跨三地机房的容器调度与流量治理平台,我处理过的问题基本都指向同一件事——如何在资源、延迟与成本之间找到当下最优解。

技术选型上我偏保守但不守旧:核心链路用 **Go** 保证可预测的延迟,性能敏感的编解码模块用 **Rust** 重写,工具链和内部平台前端则用 **TypeScript + Next.js** 快速迭代。我不追求技术栈的新鲜度,只关心它能否被团队长期维护。

除了写代码,我花大量时间在**可观测性**与**故障演练**上。团队现在的每一条核心链路都有对应的 SLO 定义、告警分级和演练脚本。过去一年,P0 级事故从 4 起降到 0 起,平均故障恢复时间(MTTR)从 47 分钟压缩到 8 分钟。

业余时间维护两个开源项目,并在公司内部主持每两周一次的架构评审会。我享受把复杂概念讲清楚的过程——这也是我判断自己是否真正理解一件事的标准。

技术栈熟练度

能力矩阵

编程语言
Go95%
TypeScript88%
Rust74%
Python80%
SQL90%
基础设施
Kubernetes92%
Docker / containerd90%
Terraform82%
Istio / Envoy76%
Prometheus / Grafana88%
数据与中间件
PostgreSQL90%
Redis88%
Kafka84%
ClickHouse72%
etcd78%
职业轨迹

经历年表

2022.06 — 至今

高级后端工程师 · 基础设施组 @ 某头部金融科技公司

负责交易链路的性能优化与容器平台建设,带领 5 人小组支撑全公司的发布与运行时治理。

2020.07 — 2022.05

后端工程师 @ 某综合电商平台

负责订单与库存中台,处理大促场景下的高并发与数据一致性问题。

2019.07 — 2020.06

软件工程师(校招) @ 某云计算服务商

参与对象存储控制面开发,从这里开始建立对分布式系统的第一手认知。

2016.09 — 2019.06

计算机科学与技术 · 硕士 @ 国内某 985 高校

研究方向为分布式存储一致性协议,毕业论文获评院级优秀。

CAPABILITIES

我能为团队解决的三类问题

高并发系统架构

面向高吞吐、低延迟场景的服务拆分、缓存策略与一致性方案设计。

  • 分库分表与读写分离
  • 多级缓存与热点探测
  • 分布式锁与幂等设计
  • 限流熔断与优雅降级

云原生基础设施

以 Kubernetes 为核心的容器平台建设,兼顾资源效率与交付速度。

  • 多集群调度与容灾切换
  • GitOps 发布流水线
  • Istio 流量治理
  • 成本可视化与弹性伸缩

可观测性与稳定性

把"能不能发现问题"变成一套可度量、可演练的工程能力。

  • SLO 体系与告警分级
  • Trace / Metric / Log 三支柱
  • 混沌演练常态化
  • 故障复盘与知识沉淀
EDUCATION

教育经历

2015 — 2019
华南理工大学学士 · 计算机科学与技术

GPA 3.8/4.0,校 ACM 集训队,连续三年一等奖学金,毕业设计获评优秀。

2019 — 2022
浙江大学硕士 · 软件工程(云原生方向)

研究方向为分布式系统与可观测性,参与国家级科研课题,发表 CCF-B 论文一篇。

PROJECTS

项目 / 成果

高频交易撮合网关2024 · 后端系统

面向撮合场景重构的接入网关。用无锁环形队列替换原有的通道模型,配合内存池与批量刷盘,把 P99 延迟从 42ms 压到 6ms,同时支撑峰值 12.4 万 QPS。

6msP99 延迟12.4万峰值 QPS-86%延迟下降
Kubernetes 多集群调度平台2023 · 基础设施

统一管理三地五个集群的工作负载编排平台。实现基于成本与时延的智能调度、跨集群故障自动切换,以及一套 GitOps 发布流水线,让业务团队自助发布。

5纳管集群-64%发布耗时31%资源利用率提升
实时协作文档内核2023 · 后端系统

基于 CRDT 的多人实时编辑内核,解决弱网环境下的编辑冲突与光标同步。自研增量快照机制,让万字文档的冷启动加载时间控制在 300ms 以内。

300ms冷启动200+并发协作者0数据冲突事故
kubectl-lens 开源插件2022 — 至今 · 开源

一个把集群资源关系可视化到终端的 kubectl 插件。支持依赖链追溯、异常资源高亮与一键诊断,被多家公司纳入内部运维工具箱。

3.2kGitHub Stars47外部贡献者18万累计下载
CONTACT

聊聊技术,或者聊聊机会