智慧中医平台需要持续补充知识库与资讯数据,但旧稿只明确了采集管理思路、若干数据源和待补充脚本位置,不能直接推断已有爬虫代码、接口或页面能力。
读完本文后,可以独立检查爬虫管理是否围绕 Gerapy 与 Scrapy 展开,数据源清单是否覆盖中药材、中医名词、西医疾病、节日节气和药食同源等内容。
文章目录
- 设计与需求
- 后端设计
- 前端设计
- 扩展功能
- Gerapy 与 Scrapy 脚本管理
- 知识库数据源清单
- 待补充脚本与方法
- Codex开发标准
- SOP 标准
- PDD 标准
- 总结
设计与需求
旧稿的核心目标是把已经编写的 Scrapy 网站采集脚本统一打包到 Gerapy 中管理,用于智慧中医数字服务平台的数据采集。已明确的范围是采集管理框架、数据采集明细、知识库数据源清单;未提供源码、接口、目录、任务运行结果和前端页面截图,因此本文只整理可核对的设计边界与待验收任务。