背景:DW 病历表 patient_id 错位污染(高逸铭案例),需按名单重摄 3 万患者。 沿用现有 PAC_COHORT_ONLY_PATIENT(cohort 收窄)时发现两个阻塞问题: 1)⭐ 静默丢数据:只要 manifest 配了 incremental.per_query(jvs-dw 配了), cold-import 任何模式都写 cursor_after=run_start。定向轮只覆盖名单内患者, 却推进全局水位 → 名单外患者在本轮期间的 DW 新写入被永久埋在游标下方。 (与本次排查发现的"12,595 个患者符合 cohort 却从未摄入"是同类机制) 修:定向模式下 cursor 保持上次水位不推进,daily 增量照常从原点接力。 2) 大名单 E2BIG:3 万个 id 的逗号串约 275KB > 环境变量单值 128KB(MAX_ARG_STRLEN)。 修:支持 PAC_COHORT_ONLY_PATIENT=@/path/to/file(每行一个 id);逗号列表照旧兼容。 顺带:定向生效时打印命中患者数,便于核对名单规模。 测试 7 例:空/空白不误判定向、逗号列表、@file(含 3 万行)、文件缺失须抛错不静默退化。 生产验证(高逸铭组 7 人小批):删除→重摄后 高逸铭 62 事实/6 诊所 → 21/1(上海时代),别人的数据清光 刘晓旭 13 → 25、徐嘉悦 126 → 130,被吞的数据补回,诊所归属全部正确 Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
| Name |
Last commit
|
Last update |
|---|---|---|
| .claude | Loading commit data... | |
| .design-sync | Loading commit data... | |
| apps | Loading commit data... | |
| clickhouse/config.d | Loading commit data... | |
| deploy | Loading commit data... | |
| docs | Loading commit data... | |
| packages | Loading commit data... | |
| scripts | Loading commit data... | |
| .gitignore | Loading commit data... | |
| .gitlab-ci.yml | Loading commit data... | |
| .npmrc | Loading commit data... | |
| .prettierrc | Loading commit data... | |
| README.md | Loading commit data... | |
| docker-compose.expose.yml | Loading commit data... | |
| docker-compose.managed.yml | Loading commit data... | |
| docker-compose.prod.yml | Loading commit data... | |
| docker-compose.yml | Loading commit data... | |
| eslint.config.mjs | Loading commit data... | |
| liu.cjs | Loading commit data... | |
| package.json | Loading commit data... | |
| pnpm-lock.yaml | Loading commit data... | |
| pnpm-workspace.yaml | Loading commit data... | |
| tsconfig.base.json | Loading commit data... | |
| turbo.json | Loading commit data... |