标签:架构

「2026-08」的文章 清除筛选

复制:主从、多主、无主

53 阅读 0 1427 字 · 约 5 分钟

每台机器只有「部分的真相」。复制是把同一份数据放到多台机器上,让系统在单机挂掉时还能继续服务。 为什么需要复制 单机有物理上限。数据量可能超过单机磁盘,请求量可能超过单机 CPU,还有机器故障、机房断电这些不可抗力。复制把数据拷贝到多台机器,用冗余换可用性。这是分布式系统最原始的动力——如果一台机器

分布式系统的复杂度从哪来

63 阅读 0 2034 字 · 约 7 分钟

把三台机器放在一起,不等于就有了分布式系统。真正的分布式系统,是让多台机器协同完成一件事——而这件事的复杂度,恰好来自「协同」二字。 为什么单机到多机不是简单的数量变化?因为单机上一切井然有序:数据在同一个内存空间,时钟只有一个,锁一把就够。一旦跨了机器,这三样全部失效。 分布式系统的所有复杂度,可

复杂度到底从哪来的?

73 阅读 0 3865 字 · 约 13 分钟

做了快十年,经手的项目从几十行脚本到几十万行系统都有。有一个问题一直绕不开:复杂度到底从哪来的? 不是「为什么会有复杂度」——那个答案太简单:问题本身有复杂度,解决它就得付出复杂度。真正的问题是:为什么很多系统的复杂度,比它要解决的问题大得多?多出来的那一部分是谁加的、什么时候加的、怎么避免?

从技术到产品的切换

81 阅读 0 1453 字 · 约 5 分钟

技术视角的完成由内部指标定义,全部能在开发环境里验证,却自洽地排除了"用的人怎么想"。当交互成本大于系统成本,该切换产品视角了:用「能用、好用、在用」重新定义完成,把技术包装起来,让业务知识成为使用产品的唯一门槛。

跑得快:把 Rust 判了缓刑

62 阅读 0 1036 字 · 约 4 分钟

跑得快实录:profiling 实测 50 票纯计算不到 1 秒、全市场外推 30 秒——按决策表 Rust 取消、分区存储和 tj-web 推迟,三个大复杂度全部缓刑;把「什么时候优化」写成可对照的触发阈值。

跑得稳:不盯也能跑

56 阅读 0 1092 字 · 约 4 分钟

跑得稳实录:任务表让跑批可追溯,调度写进代码不依赖宿主 cron(Docker/本地同构),备份先做、告警克制,以及「机制就绪不等于验证完成」的诚实边界。

跑得准:300% 的假收益与真的 IC

56 阅读 0 1264 字 · 约 5 分钟

跑得准实录:样本扩到 50 只后发现回测里 +300% 的假收益——真实价撮合在除权日权益跳变,账户换后复权口径;补全数据校验,IC 验证动量 20 日在 10/20 日窗口显著为正。

能跑:当设计稿撞上真实数据

62 阅读 0 1717 字 · 约 6 分钟

能跑阶段实录:契约先行防返工,接口文档和实际的落差,复权因子校验被真实数据推翻,验证逼出三个 bug,以及「10 万买不起一手茅台」的资金约束教训。