【问题标题】:Looking for artificial intelligence (AI) cookbook reader research寻找人工智能 (AI) 食谱阅读器研究
【发布时间】:2011-04-03 16:47:54
【问题描述】:
我正在寻找有关阅读食谱食谱的 AI 技术的研究(已发表)。食谱是一个非常有限的领域,在自然语言识别引擎中可能具有一定的准确性。
我打算编写一个程序,允许将食谱从网络浏览器复制/粘贴到 AI 中,并让它通过“阅读”食谱来确定标题、作者、成分、说明、营养信息等。我还希望能够处理 PDF 文件(我有很多收藏),也许也只是使用复制/粘贴。
输出将是某种(标准)基于 XML 的格式,可由配方组织者读取。
我考虑的是博士或硕士级别的工作。
【问题讨论】:
标签:
artificial-intelligence
nlp
【解决方案1】:
您可能会发现与 AI 相关的一个子领域是 information extraction。
信息提取算法通常通过使用规则(例如正则表达式)来识别文本中的实体和关系。这些规则既可以手动定义(即 Suiseki 算法),也可以通过有监督的机器学习算法(即 RAPIER、Wrapper Induction、Conditional Random Fields)学习。
例如,信息提取算法可能会从职位发布中获取数据:
Job Title:高级 DBMS 顾问
Location:德克萨斯州达拉斯
Responsibilities:DBMS 应用程序顾问与项目团队一起定义基于 DBMS 的解决方案,以支持企业部署电子商务、销售人员自动化和客户服务应用程序。
Desired Requirements:3-5 年经验。使用 Visual Basic、C/C++、Powerbuilder、Progress 或类似工具开发 Oracle 或 SQL Server 应用程序。最近在两个开发人员中安装和配置 Oracle 或 SQL Server 的经验。和部署环境。
Desired Skills:了解 UNIX 或 NT,脚本语言。了解结构化软件工程和项目管理的原则
...并将其提炼成这个模板:
title: 高级 DBMS 顾问
state: TX
city: 达拉斯
country: 美国
language: Powerbuilder, Progress, C, C++, Visual基础
platform: UNIX, NT
application: SQL Server, Oracle
area: 电子商务, 客户服务
required years of experience: 3
desired years of experience: 5
Ray Mooney 和他在德克萨斯大学奥斯汀分校的团队在信息提取方面做了一些出色的工作。以下是一些可能成为很好起点的参考资料: