计算机应用 ›› 2013, Vol. 33 ›› Issue (01): 186-188.DOI: 10.3724/SP.J.1087.2013.00186
FENG Ruwei,XIE Qiang,DING Qiulin
摘要: 针对传统集中式索引处理大规模数据的性能和效率问题,提出了一种基于文本聚类的检索算法。利用文本聚类算法改进现有的索引划分方案,根据查询与聚类结果的距离计算判断查询意图,缩减查询范围。实验结果表明,所提方案能够有效地缓解大规模数据建索引和检索的压力,大幅提高分布式检索性能,同时保持着较高的准确率和查全率。
中图分类号: