Discuz! Board
標題:
搜索一切
[打印本頁]
作者:
bitheerani00000
時間:
2025-10-19 18:56
標題:
搜索一切
互联网档案馆 (Internet Archive) 拥有超过 2000 万份馆藏,拥有一个便捷的搜索方式来精准查找所需内容至关重要。同样重要的是,能够灵活地筛选数据,以便您查看与您最相关的数据子集。我们很高兴推出两项新功能,它们可能会彻底改变您的搜索方式。
分面过滤
执行站点搜索后,无论是从每个页面右上角的搜索表单执行,还是直接进入搜索页面,除了搜索结果外,您还会在左侧看到一堆新的复选框。这些复选框按类别分组,例如“媒体类型”和“主题和主题”。
点击任意复选框即可将相应的关键词添加到搜索条件中,让您更精确地定义筛选后的
手机号数据库列表
搜索结果。勾选同一类别中的多个关键词,将显示与任意所选关键词匹配的项目;勾选两个不同类别中的项目,则仅显示同时匹配两个关键词的项目。尝试一下,您就会发现它非常直观。勾选或取消勾选新关键词会导致搜索结果即时重新过滤。
我们一直在寻找一种更强大、更直观的搜索结果筛选方法。当我们对分面搜索界面进行用户测试时,测试人员非常喜欢它。这是一个互联网上早已广泛使用的熟悉界面,兼具简洁性和丰富性。
每天,我们的搜索页面平均有 5 万次点击,因为您,我们的用户,正在搜索我们存档项目的标题、创建者以及其他各种元数据。但您一直想知道,什么时候才能不仅在所有项目中进行搜索,还能在项目内部进行搜索。多年来,您一直能够使用我们的 BookReader 在单本书的文本内进行搜索,但此前从未能够一次性在互联网档案馆所有 900 万个可用文本项目中进行搜索。直到现在。
全文搜索
您只需执行以下操作:在搜索页面的文本字段中输入搜索查询后,勾选文本字段下方的“搜索书籍全文”,然后点击或轻触“开始”。就这样!几秒钟内,您就能获得数百万篇文本的搜索结果。请注意,左侧的方面与非全文搜索略有不同;只需点击或轻触其中一个即可将其添加为筛选条件。
目前,我们仍处于测试阶段。可以肯定地说,我们在配置和部署全文搜索引擎方面面临诸多挑战,从创建Elasticsearch集群,到处理与奇怪字体、连续页眉或语言识别相关的光学字符识别 (OCR)问题。我们仍在不断改进,未来仍任重道远。
但请务必使用它!试着从一本早已被遗忘的书中搜索一些萦绕你脑海的短语,看看会出现什么。现在,你手边就有 900 万篇文本的内容了。
歡迎光臨 Discuz! Board (http://backup0014.win1.me/demo1/)
Powered by Discuz! X3