【发布时间】:2008-11-07 01:42:26
【问题描述】:
我正在寻找一个不使用搜索索引文件的开源网络搜索库。 你知道吗?
谢谢, 肯尼斯
【问题讨论】:
标签: search
我正在寻找一个不使用搜索索引文件的开源网络搜索库。 你知道吗?
谢谢, 肯尼斯
【问题讨论】:
标签: search
你的意思是:
搜索.cgi
#/bin/sh
arg=`echo $QUERY | sed -e 's/^s=//' -e 's/&.*$//'`
cd /var/www/httpd
find . -type f | xargs egrep -l "$arg" | awk 'BEGIN {
print "Content-type: text/html";
print "";
print "<HTML><HEAD><TITLE>Search Result</TITLE></HEAD>";
print "<BODY><P>Here are your search results, sorry it took so long.</P>";
print "<UL>";
}
{ print "<LI><A HREF=\"http://yourhost.com/" $1 "\">" $1 "</A></LI>"; }
END {
print "</UL></BODY>";
}'
未经测试...
【讨论】:
原始发帖人在对此回复的评论中澄清说,他正在寻找的内容本质上是“greplike search but through HTTP”,并提到他正在寻找使用小磁盘的东西,因为他正在使用嵌入式系统。
我不知道有任何相关项目,但您可能想查看您选择的语言中的 html 解析器和 xquery 实现。您应该能够使用前者处理“现实生活”中的 html 混乱,并编写一个几乎与您希望使用后者一样详细的搜索。
我假设您将使用一组将提供或已存储在本地的 url,因为在嵌入式设备中实际爬取整个网络、发现链接等的想法是完全不现实的。
虽然有一个很好的 html/xquery 实现,但你确实有提取所有链接的工具..
我原来的回答,确实是要求澄清:
不确定你的意思。您如何想象没有索引的搜索?为每个查询爬网?通过管道连接到谷歌?还是您指的是您要避免的特定类型的搜索索引文件?
【讨论】:
我猜没有(至少这很受欢迎,足以让这里的用户知道)。
我们已经着手编写我们自己的搜索系统。
【讨论】: