适合轻量级学习用
| 文件 | 文件名 | |
|---|---|---|
| 文档 | df | |
| 域 | ff | |
| 文档-域 | dff | |
| 词频 | tf | |
| 词偏移量 | tp |
- 0.没版本控制
- 1.索引文件的读写没加锁
- 2.索引结构式简化版本的
- 3.文件没有合并和划分
- 4.增量,查询有个重置
- 5.Payload没处理
- 6.多文件操作没用事务(可采用临时文件的方式
- 7.查询加载用的读写锁
- 8.查询没搞语法简单交集(测试量小感觉很快,后面想添加个缓存)
- 9.打分准备用bm-25 基于查询出来的 还没处理
- 10.词偏移量文件感觉还是很大
- 11.词频加载多线程
- 1.文件的读写用的Lucene 3.0基础读写(字节流
- 2.查询用的是跳表
- 0.词合并