1.9 KiB
古籍参考库接入
数据源:xiaopangxia/TCM-Ancient-Books,本项目直接跟踪其提交 db0155dc7c42b9c6b3736896661f317c7110038f 的完整文件快照,其中有 701 个 TXT 原文文件。普通 git clone 或部署打包即可取得原文,无需初始化子模块或在部署时访问 GitHub。
部署时先执行 server/database/migrations/2026_10_08_tcm_ancient_book_sources.sql,然后在项目根目录运行:
php server/scripts/install_tcm_ancient_books.php
安装脚本只读取仓库自带的语料,不运行 Git 命令或下载文件。它按 GB18030 读取 701 个原文文件,并建立 server/knowledge/tcm-ancient-books-index.json 及按需读取的 server/knowledge/tcm-ancient-books-index/。生成的索引文件已被 Git 忽略。安装完成后重启 PHP 服务或工作进程,使索引生效。部署镜像需要包含 server/knowledge/tcm-ancient-books/ 并运行建索引步骤,否则古籍检索不会启用。
此前已经初始化过古籍子模块的服务器,升级为普通文件前须先把旧子模块目录移开,否则 git pull 会因同名文件已存在而中止。确认备份目录尚不存在后,在项目根目录执行:
mv server/knowledge/tcm-ancient-books server/knowledge/tcm-ancient-books.submodule-backup
git pull
php server/scripts/install_tcm_ancient_books.php
确认新目录已有 701 个 TXT 且索引成功后,旧备份目录即可清理。
索引保留每段的书名、篇名、原文件名和行号,模型只收到与患者病症词匹配的至多两条短原文。来源记录指向本地原文件及上述资料版本,不依赖外部链接。古籍只是文献参考,不能代替病历证据、现代临床判断、急症处理和医生审核。历史报告不自动补标古籍来源;新报告保存生成时实际传给模型的片段清单。