- 归一化法规 markdown,避免标题/列表标记干扰层级识别 - 按章节条进行层级语义切分,优先保持条级完整 - 超长 chunk 优先句级切分,最终保留 token 上限兜底 - 补充分块回归测试,覆盖 markdown 条款和超长场景