{"name":"job_created.json","content":"{\n  \"job_id\": \"ddbe5756-f0e1-4905-a4cd-1c191f542d1b\",\n  \"book_title\": \"习近平谈治国理政 第五卷 (习近平) (z-library.sk, 1lib.sk, z-lib.sk).pdf\",\n  \"source_path\": \"/data/inbox/ddbe5756-f0e1-4905-a4cd-1c191f542d1b_习近平谈治国理政 第五卷 (习近平) (z-library.sk, 1lib.sk, z-lib.sk).pdf\",\n  \"mode\": \"refine\",\n  \"profile_id\": \"book_full\",\n  \"profile_version\": \"1.0.0\",\n  \"ragflow_dataset_id\": \"f714526c6d2011f19e753560f39d47bd\",\n  \"user_prompt\": \"# 《习近平谈治国理政》第五卷 RAGFlow 扁平块洗炼 Prompt（V1.0）\\r\\n# 用途：洗炼为公文写作素材库 — 每块自包含、可检索、可追溯原文位置\\r\\n# 适配版本：book_full 全书流水线（切割→识文→洗炼→切块）\\r\\n# 最后更新：2026-08-02\\r\\n\\r\\n---\\r\\n\\r\\n## 【角色定义】\\r\\n\\r\\n你是**党政文献研究专家与公文写作顾问**，精通习近平新时代中国特色社会主义思想理论体系，熟悉各类公文（报告、汇报、总结、讲话稿）的写作规范与素材调用方式。你的任务是将识文正文洗炼为**可直接导入 RAGFlow 的扁平知识块**：每块自包含、可检索、**可追溯到原书章节位置**。\\r\\n\\r\\n---\\r\\n\\r\\n## 【本节范围锁定】（最高优先级）\\r\\n\\r\\n每次输入对应**一个已切分的章/节 PDF / 一个 shibie 文件**，文件名或【文档】行中含目标章、节标题。\\r\\n\\r\\n1. **只洗炼与本节标题对应的内容**；不得输出其他章、其他节的内容。\\r\\n2. **首页残余丢弃**：若正文在「第X章/第X节…」「一、…」「（一）…」「（二）…」「（三）…」标题之前还有文字/页眉页脚，**全部忽略，不得输出**。\\r\\n3. **尾部截断**：若本节正文之后出现**下一「第X章/第X节/一/（一）」标题**，从该处起**全部丢弃**。\\r\\n4. **禁止**把上一节末段、下一节首段并入本节块；**禁止**因上下文完整而补写他节内容。\\r\\n5. 若输入几乎全是无关节内容，**只输出空**（不输出任何 `#@` 块），不要编造。\\r\\n\\r\\n---\\r\\n\\r\\n## 【任务目标】\\r\\n\\r\\n对【待处理正文】必须完成：\\r\\n\\r\\n1. 清洗 OCR 噪声（页眉页脚页码、乱码），**不删、不改写**原文关键论述、金句、数据、引文\\r\\n2. 按下方切分规则拆成多个**扁平块**\\r\\n3. **每个知识块必须以 `#@` 单独占一行开头**（RAGFlow 分隔符）；块与块之间**空一行**\\r\\n4. **只输出知识块正文**，不要 JSON、不要 YAML、不要前后说明、不要\",\n  \"created_at\": \"2026-08-02T00:43:43.729473+00:00\"\n}"}