第 3 章 · 04 增量同步:多进程并行与断点续传 本节摘要:本节把数据引擎的「最后一块拼图」——增量同步讲透。回填模式一次性灌入全市场历史数据只需要一次,但日常模式每天都要跑——它的目标是把全市场 5000+ 只股票「最后日期 + 1」到今天的新数据拉完,且23 分钟内完成。我们会先讲为什么日常模式必须用多进程并行而不是多线程;再讲 Sequoia-X 的任务切分策略(按股票代码切片给 8 个 worker);然后讲「先删后写」的幂等写入模式(保证重复跑不会污染数据);最后讲两个关键工程保障——定期重连与断点续传。学完本节,你就掌握了「把一个慢 IO 任务压到分钟级」的完整工程方法论。 内容来源:原项目数据引擎模块的增量同步代码精读 + Python 多进程工程实践。