海量文本

我要報錯
  • 一種基于MapReduce的分布式索引方法

    摘要:海量文本快速索引是云檢索系統(tǒng)的一個難點,而分布式索引程序的開發(fā)難度較大。文中提出了一種基于MapReduce的分布式索引方法,通過在Map函數(shù)中執(zhí)行文檔的解析及索引,以及在Reduce函數(shù)中合并索引數(shù)據(jù),以減少文檔排序的工作量,提高索引效率。實驗結(jié)果表明,該方法適用于海量數(shù)據(jù)的并行處理。