本书是信息检索的教材,旨在从计算机科学的视角提供一种现代的信息检索方法。书中从基本概念讲解网络搜索以及文本分类和文本聚类等,对收集、索引和搜索文档系统的设计和实现的方方面面、评估系统的方法、机器学习方法在文本收集中的应用等给出了最新的讲解。
什么是排序SVM、XML、DNS和LSI?什么是信息检索中的垃圾信息、隐藏页和门页?MapReduce和其他一些并行运算方法是如何实现由兆字节到百万兆字节的飞跃的?这些问题你都能从本书中找到答案。本书首次将构建Web搜索引擎的复杂过程以一种清晰的全景方式展现给读者。——Peter Norvig,计算机科学家,Google研发总监
本书对信息检索这个举足轻重、发展迅猛的领域进行了全面、准确的介绍,是一本不可多得的教材。——Raymond Mooney,得克萨斯大学奥斯汀分校教授
本书选材独特,对信息检索的基础知识和发展方向进行了生动描述。——Jon Kleinberg,康奈尔大学教授