【发布时间】:2017-09-23 03:29:48
【问题描述】:
我已经使用 TYPO3 indexed_search 完成了几个网站。但是我觉得我仍然不明白 indexed_search 和爬虫之间关系的本质。例如,根据一些作者来索引 tt_news,我只需要一个通用爬虫配置和一个用于 tt_news 的 indexed_search 配置;但是对于教程的其他作者,我应该为 tt_news 创建一个爬虫配置。
我不清楚 crawler 和 indexed_search 之间的关系。它们如何匹配?根爬虫配置在找到 indexed_search 配置时仅运行它就足够了吗?还是两者都需要生成 URL?我已经设法只使用一个爬虫根配置创建了一个索引,但我通过我自己的调用 cli_dispatch.phpsh 的 shell 脚本运行索引。
indexed_search 和 crawler 在功能(生成 URL)方面是否多余?
欢迎提供任何线索。
最佳,
乙。
【问题讨论】:
标签: content-management-system web-crawler typo3