闭包构建前端搜索倒排索引,通过封装状态、隔离副作用、按需增量更新,在保障 O(1) 查询性能与内存可控前提下,实现可复用、可测试、易持久化的轻量级全文检索能力。
用闭包构建
前端
搜索倒排索引,核心是封装状态、隔离副作用、按需更新,同时保持内存可控和查询响应灵敏。它不是为了炫技,而是让索引逻辑可复用、可测试、可增量维护。
用闭包封装索引状态与操作方法
把
实例、停用词表、分词规则等私有数据封在闭包内,只暴露
、
、
等干净接口。外部无法直接修改内部结构,避免意外污染索引。
例如:每次调用
返回一个新实例,彼此状态完全隔离
内部
用
而非普通对象,保障 O(1) 查找性能
分词逻辑(如空格切分 + 小写归一)也封装在闭包内,后续可无缝替换为
或正则分词
支持增量更新,避免全量重建
闭包内维护文档快照(如
),新增或修改文档时,只提取该文档的新词项,更新对应词的 ID 集合;删除时仅从各词项中剔除该 ID。
不重新遍历全部文档,主线程不卡顿
配合
分片执行,适合加载上百篇本地 Markdown 或 JSON 文档的场景
高频词(如“系统”“应用”)可设阈值自动截断,防止单个词条映射膨胀
查询阶段做轻量布尔解析与结果合并
闭包暴露的
方法接收字符串,内部用简易递归下降解析器处理
/
/
,转为集合运算:
面向设计的AXUI前端框架表单
面向设计的AXUI前端框架表单是一款包含表格、列表、弹窗等的AXUI前端框架表单下载。
下载
立即学习
“
前端免费学习笔记(深入)
”;
→ 取两个词项 ID 集合的交集
→ 取并集
→ 从 node 的集合中排除 npm 的集合
结果默认按字段权重(title > content)和词频加权排序,不依赖完整 TF-IDF,用
快速估算
自动内存管理与持久化衔接
闭包内可集成序列化策略:索引构建完成后,调用
得到紧凑 JSON 字符串,存入
或
;下次初始化时优先尝试
加载,跳过解析和分词开销。
对长文档主动截断(如只索引前 800 字符),平衡精度与体积
提供
和
方法,显式释放 Map 引用,帮助 GC 回收
监听页面卸载事件,在退出前自动保存未持久化的增量变更
MapaddremovesearchcreateInvertedIndex()indexMapMap> segmentitdocStore: MaprequestIdleCallbacksearch(query)ANDORNOT"vue AND typescript""react OR next""node NOT npm"freq × (1 + log(totalDocs / docCount[word]))serialize()localStorageIndexedDBdeserialize()clear()destroy()