量化交易
从市场微结构入手,建立量化工程全栈视角
覆盖从因子研究、回测方法论到执行算法与高频架构的整条链路,适合策略研究员与工程师系统切入。
发布来自土法炼钢兴趣小组的知识、笔记、进展和应用。主题包括数据结构和算法、编程语言、网络安全、密码学等。
第一次访问时先按主题切入,比直接沿着时间线翻文章更快。
量化交易
覆盖从因子研究、回测方法论到执行算法与高频架构的整条链路,适合策略研究员与工程师系统切入。
大模型基础设施
把训练、推理、量化与服务化串成一条工程主线;先建立 GPU 心智模型,再进入引擎与量化落地。
密码学
先看密码学系列总目录,再顺着 PQC、FHE 与迁移工程深入。
排序算法
把 TimSort、pdqsort、radix sort、external sort、parallel sort 串成一条工程化阅读路径。
把已经形成系列阅读闭环的主题集中在首页,减少在 400 多篇文章里盲找的成本。
按最近更新时间排序;如果你想系统性阅读一个主题,优先回到上面的专题入口。
HNSW 是当前向量检索的事实标准算法。
加密和认证必须同时进行——本文深入 AEAD 的形式化安全定义,逐步拆解 AES-GCM 的 GHASH 有限域乘法、ChaCha20-Poly1305 的组合构造,以及 nonce-misuse resistant 设计
在 distributed/54 的方法论之上,钉住 FoundationDB 如何用 Flow、模拟网络/磁盘/时钟、种子重放与 Buggify 覆盖角色恢复路径;不复述 DST 通识,只写工程接口与测试落点。
拆解 Iceberg 的四层元数据:catalog 指针 → metadata.json → manifest list(snapshot)→ manifest file → data file。讲清 snapshot 与 manifest 里的分区数据和列级 stats(lower/upper bound、null/value count)如何让一次查询不 list 目录就收敛到文件集合,并给出表规范 V1/V2/V3 的版本边界。基于 pyiceberg 0.11.1 真实建表逐层 dump。
用 MySQL 8.0.36 源码钉住 InnoDB 的 undo 式 MVCC:聚簇行上的 DB_TRX_ID / DB_ROLL_PTR、ReadView 的 m_up_limit_id / m_low_limit_id / m_ids、changes_visible 判定、RC 每语句关闭视图 vs RR 复用视图,以及沿 undo 链重建可见版本的路径。对照 PostgreSQL CLOG 方案,并给出 Docker 可复现实验步骤。
从线程模型到页格式、从 undo log MVCC 到 binlog 两阶段提交——对 MySQL InnoDB 做源码级拆解,并与 PostgreSQL 内核系列逐章对照。20 篇覆盖内核机制与生产运维实战,面向 MySQL DBA、从 PG 转 MySQL 的后端与数据库内核开发者。
在已有 MVCC 文章基础上深入 PG 并发控制的三个基础设施:CLOG 的 SLRU 结构(事务状态位、页面格式、SLRU 淘汰)、hint bit 的写入时机和竞争问题(何时写、谁写、写坏了怎么办)、PG 14 snapshot scalability 优化的具体机制(ProcArrayLock 为什么是瓶颈、xid/xmin 的原子更新如何减少持锁路径),以及事务 ID 回卷(wraparound)的威胁模型。最后与 InnoDB undo log 方案做系统性对比。
Raft 论文 18 页就能读完,但 etcd/raft 用了 15000 行 Go 才把它变成能在生产环境跑的代码。这篇文章从论文的每一个核心机制出发,逐一拆解工程实现中论文没说的东西:PreVote、ReadIndex、LeaderTransfer、ConfChange V2、流水线复制、Async Apply,以及 TiKV 的 Multi-Raft 实践。最后做一次精确的 Paxos 对比,并坦诚讨论 Raft 的已知缺陷。
深入解析 Jepsen 测试框架的方法论、工具链与经典发现,涵盖线性一致性检查、故障注入策略以及对工业界数据库的实际影响。
基于 Linux 6.8 头文件与实测 verifier 日志,拆解 bpf_reg_state / bpf_func_state / bpf_verifier_state 的分层抽象域、DFS 分支计数与 is_state_visited 裁剪、precision 回溯——衔接 02 框架与 04 拒绝模式。
git repack 后 .pack/.idx 各存什么?对照 gitformat-pack 读 PACK 头、type/size 变长编码、idx v2 扇区与 fanout,并用 hexdump 与 verify-pack 钉住 OFS_DELTA 链。
GEMM 是 GPU 算子优化的标杆。在 RTX 3060 Ti 上实测四个版本:朴素 990、shared tiling 1309、寄存器分块 64 达 4447、128 达 6375 GFLOP/s(峰值 39%)。讲清每一步优化提高的是什么,以及为什么数据复用是关键。
FlashAttention 把注意力重写成分块的在线 softmax,不落地 N×N 分数矩阵,用重算换访存。本文推导算法、给出实测正确的简化实现(误差 4e-7、避免 16.8MB 分数矩阵),并引用原论文的加速与显存数据。
探索 Linux 下一代高性能异步 I/O 接口 io_uring,从核心原理到性能对比,再到与现有网络库的集成。
SQPOLL 烧 CPU、fixed buffer 内存泄漏、CQE overflow 丢事件、内核版本兼容性噩梦——io_uring 在生产中踩过的坑,逐个拆解。