使用指南
把本地文档问答真正用起来的指南
每篇都写给具体场景:要做的动作、会看到的数字、以及做不到的时候该怎么退。不写原理教科书,只写能立刻照着做的步骤。
浏览器与硬件要求,附具体数字
哪些浏览器能用、WebGPU 改变了什么、导入前就能套用的内存估算、手机上收紧的限额,以及没有 GPU 时生成档的真实速度。
检索不准怎么调:分块、提问与模型档位
从分块大小与重叠、文件结构、提问用词、严格度两档,到向量与关键词各自擅长的查询类型,以及什么时候才真的值得换成更大的嵌入模型。
扫描件 PDF:先判断有没有文字层,再修
十秒分辨扫描件还是文本件,工具为什么用 PDF_NO_TEXT_LAYER 直接拒绝,怎么在不把页面送出去的前提下做 OCR,以及识别错误如何变成检索错误。
离线配置:一次弄好,之后断网也能问
首次访问要下载什么、Service Worker 缓存了哪些文件、怎么自己确认已经缓存、飞行模式怎么测,以及模型缓存被回收和 persist 到底解决了什么。
怎么证明文档没有离开浏览器
用开发者工具做一次五分钟自查,证明文件确实留在本机;看清哪些做法看上去私密、实际在上传;以及哪几种情况仍然必须由人读一遍原文才能决定。