现居杭州 · 开放远程协作

你好,我是 唐明轩

高级软件工程师 / 后端 & 云原生架构
专注 |

十余年一线研发经验,做过日活千万级的交易系统,也带过从 0 到 1 的技术团队。 我喜欢把复杂的系统拆解成清晰的问题,用工程化手段让它们稳定、可观测、可演进。

  • 0年研发经验
  • 0开源仓库
  • 0技术文章
  • 0线上可用性
tmx@tangmingxuan:~$
const engineer = {
  name: '唐明轩',
  role: 'Senior Engineer',
  stack: ['Go', 'Java', 'Kubernetes'],
  focus: ['分布式', '高并发', '云原生'],
  coffee: Infinity,
  shipping: true,
};
// 让每一行代码都对得起线上流量
01 / 关于我

用工程解决真实问题

我是唐明轩,一名深耕后端与基础设施的高级工程师。过去 12 年里,我参与并主导过电商交易、 金融风控、实时数据平台等多个核心系统,从单机服务一路演进到跨区域多活架构。

我信奉「简单、可测、可观测」的工程哲学:能用架构解决的问题,不靠堆人力; 能用自动化兜住的风险,不靠运气。除了写代码,我也喜欢写文档、做分享, 帮助团队把经验沉淀成可复用的工程资产。

业余时间我会维护几个开源项目,折腾 Homelab,也偶尔写点关于性能优化与系统设计的随笔。

  • 当前某头部互联网公司 · 技术专家
  • 方向分布式系统 / 云原生 / 高并发架构
  • 爱好开源、骑行、手冲咖啡

核心关注

系统设计性能调优可观测性 Service Mesh数据一致性研发效能

技术信条

“先让它正确,再让它快,最后让它简单。”
02 / 技能栈

我常用的工具箱

后端与语言

Go
95
Java / JVM
90
Python
82
Rust
65

基础设施

Kubernetes
93
Docker / CI·CD
90
Terraform
78
Service Mesh
80

数据与中间件

MySQL / 分库分表
92
Redis
90
Kafka
85
ClickHouse
76
gRPCetcdPrometheusGrafanaOpenTelemetry IstioNginxELKPulsarArgo CD GraphQLPostgreSQLVaultFlink
03 / 职业经历

一路走来

  1. 技术专家 · 后端架构

    2021 — 至今

    某头部互联网公司 · 交易中台

    • 主导交易核心链路从单体到微服务的拆分,支撑日均 3000 万订单峰值。
    • 设计多区域多活容灾方案,将 RTO 从分钟级压缩到 30 秒内。
    • 推动全链路可观测体系落地,线上问题平均定位时间下降 60%。
  2. 高级软件工程师

    2017 — 2021

    某金融科技公司 · 风控平台

    • 从 0 搭建实时风控引擎,规则毫秒级生效,拦截率提升 35%。
    • 基于 Kafka + Flink 构建实时特征平台,服务 20+ 业务线。
    • 带领 5 人小组完成平台化改造,交付效率提升约 2 倍。
  3. 软件工程师

    2014 — 2017

    某电商创业公司 · 基础架构

    • 负责订单与库存服务的开发与性能优化,QPS 提升 8 倍。
    • 搭建公司早期 CI/CD 与监控体系,发布频率从周级到日级。
  4. 计算机科学与技术 · 硕士

    2011 — 2014

    研究方向:分布式存储与一致性算法

04 / 项目与开源

做过的一些东西

GoKubernetes

orion-gateway

高性能云原生 API 网关,支持动态路由、限流熔断与灰度发布,单实例可承载 10 万 QPS。

★ 4.2k查看 →
GoFlink

stream-lab

实时数据实验平台,把流处理作业的开发、调试、上线变成声明式配置,降低实时计算门槛。

★ 2.6k查看 →
RustWASM

edge-cache

基于 WASM 的边缘缓存引擎,支持自定义缓存策略,冷启动毫秒级,已在生产边缘节点运行。

★ 1.8k查看 →
Observability

trace-cookbook

一份面向工程团队的分布式追踪实践手册,涵盖埋点规范、采样策略与告警设计。

★ 3.1k查看 →
05 / 技术文章

最近写的一些思考

把「高可用」讲清楚:从 SLO 到多活容灾

很多人把高可用等同于加机器,但真正的可用性来自对故障的假设与预算。这篇文章聊聊我如何用 SLO 驱动架构决策。

一次线上 P0 的复盘:当缓存击穿了数据库

凌晨两点的一次雪崩,让我重新理解了「热点 key」与「预热」的意义。附完整的时间线与修复方案。

Kubernetes 生产实践:我们踩过的 7 个坑

从资源配额到探针配置,从 HPA 抖动到 etcd 容量,这些都是文档里不会告诉你的经验。

Go 并发模式:别让 goroutine 成为泄漏源

context 取消、channel 关闭、worker pool 的正确姿势,以及我常用的几个排查工具。

06 / 联系

想聊聊技术或合作?

无论是架构咨询、技术分享还是开源协作,欢迎随时找我。