【问题标题】:Is there an Open-Source Web Search Library that does not use a Search Index File?是否有不使用搜索索引文件的开源 Web 搜索库?
【发布时间】:2008-11-07 01:42:26
【问题描述】:

我正在寻找一个不使用搜索索引文件的开源网络搜索库。 你知道吗?

谢谢, 肯尼斯

【问题讨论】:

    标签: search


    【解决方案1】:

    你的意思是:

    搜索.cgi

    #/bin/sh
    arg=`echo $QUERY | sed -e 's/^s=//' -e 's/&.*$//'`
    cd /var/www/httpd
    find . -type f | xargs egrep -l "$arg" | awk 'BEGIN { 
            print "Content-type: text/html"; 
            print "";
            print "<HTML><HEAD><TITLE>Search Result</TITLE></HEAD>";
            print "<BODY><P>Here are your search results, sorry it took so long.</P>";
            print "<UL>";
        }
        { print  "<LI><A HREF=\"http://yourhost.com/" $1 "\">" $1 "</A></LI>"; }
        END {
            print "</UL></BODY>";
        }'
    

    未经测试...

    【讨论】:

    • 嗯.. 类似的东西.. 但是,一个更精致的版本:) 由于它会像预期的那样慢,我正在考虑在用户等待时显示部分结果。
    【解决方案2】:

    原始发帖人在对此回复的评论中澄清说,他正在寻找的内容本质上是“greplike search but through HTTP”,并提到他正在寻找使用小磁盘的东西,因为他正在使用嵌入式系统。

    我不知道有任何相关项目,但您可能想查看您选择的语言中的 html 解析器和 xquery 实现。您应该能够使用前者处理“现实生活”中的 html 混乱,并编写一个几乎与您希望使用后者一样详细的搜索。

    我假设您将使用一组将提供或已存储在本地的 url,因为在嵌入式设备中实际爬取整个网络、发现链接等的想法是完全不现实的。

    虽然有一个很好的 html/xquery 实现,但你确实有提取所有链接的工具..

    我原来的回答,确实是要求澄清:

    不确定你的意思。您如何想象没有索引的搜索?为每个查询爬网?通过管道连接到谷歌?还是您指的是您要避免的特定类型的搜索索引文件?

    【讨论】:

    • >> 您如何看待没有索引的搜索?我将其描述为类似 grep 的搜索,但通过 HTTP。 >> 为每个查询爬网?是的。 >> 通过管道连接到谷歌?不,我避免创建索引文件,因为在嵌入式环境中磁盘空间稀缺。
    【解决方案3】:

    我猜没有(至少这很受欢迎,足以让这里的用户知道)。

    我们已经着手编写我们自己的搜索系统。

    【讨论】:

      猜你喜欢
      • 2012-12-04
      • 1970-01-01
      • 1970-01-01
      • 2018-11-06
      • 1970-01-01
      • 2010-10-14
      • 2016-03-16
      • 2014-09-09
      • 1970-01-01
      相关资源
      最近更新 更多