slicead-client

OCR、AI 辅助阅读与向量检索

OCR 文本识别

AI 辅助阅读

配置聊天模型

进入“设置” -> “语言模型” -> “个人 API”,填写以下字段:

填写后建议点击“测试连接”。如果提示缺少 Base URLAPI Key 或模型名,请逐项补齐;如果提示连接失败,通常需要检查网络、token 权限、服务商额度、模型名称和 Base URL 是否匹配。

Base URL 与 Token 怎么填

常见填法如下:

不要把 Base URL 填到 API Key 里。设置页会对部分明显填错的情况给出提示。

什么是向量化书籍

“向量化书籍”是把书籍文本切成多个片段,再用 Embedding 模型把每个片段转换成一组数字向量,并保存到本地向量目录中。向量不是给人直接阅读的内容,而是给检索系统判断“语义相似度”的索引。

它的用途主要是:

扫描版 PDF 需要先 OCR。没有可提取文本时,向量化会提示“未提取到可向量化文本,请先执行 OCR”。

向量化模型是什么

向量化模型通常也叫 Embedding 模型。它和普通聊天 LLM 的区别是:

两者经常配合使用:Embedding 模型先找资料,聊天 LLM 再基于资料组织回答。

配置 Embedding 模型

进入“设置” -> “语言模型” -> “向量检索”,填写以下字段:

Embedding 配置完整后,可在书架页右键书籍选择“开始向量化”。当模型或索引版本变化时,书籍可能显示“向量待重构”,此时右键选择“重构向量索引”即可。