【发布时间】:2017-05-25 13:09:17
【问题描述】:
Bing spell check API 对请求要进行拼写检查 [mode=spell] 或校对 [mode=proof(default)] 的文本块有 10,000 个字符的限制。
但是我遇到了一个问题,即一大段拼写错误的文本明显低于 10k 的限制,在拼写检查请求中没有返回带有标记的标记,但在校对请求中返回。
什么给了?拼写检查有下限吗?
以下两个请求的输出。我在这两种情况下都使用 POST 并且两个响应都返回 200 OK
模式:拼写
请求:
发布 https://api.cognitive.microsoft.com/bing/v5.0/spellcheck/?mode=spell HTTP/1.1 内容类型:application/x-www-form-urlencoded 主机: api.cognitive.microsoft.com Ocp-Apim-Subscription-Key: ••••••••••••••••••••••••••••••••
Text=这是一个很长的句子,这里有一些错误。它应该 成为一个问题,但我想不出一个很长的问题。也许那 意思是我没有什么严肃的问题要问?
回应:
变化:接受编码 BingAPIs-TraceId: 2802E335D1A04D22865FCA6039E61233 X-MSEdge-ClientID: 3F1CA016365F6B862DF6AA10376E6A50 X-MSAPI-用户状态:97c3 BingAPIs-Market: en-US X-MSEdge-Ref: Ref A: 2802E335D1A04D22865FCA6039E61233 参考 B: E62A760E2E5891B3D022742C51159258 参考 C:2017 年 1 月 10 日星期二 13:44:58 PST apim 请求 ID:7b94e044-d1fe-4bbc-a153-4d4e5ef30586 严格的传输安全性:max-age=31536000;包括子域; 预加载缓存控制:max-age=0,私有日期:2017 年 1 月 10 日,星期二 21:44:57 GMT P3P: CP="NON UNI COM NAV STA LOC CURa DEVa PSAa PSDa OUR IND" Content-Length: 44 Content-Type: application/json; charset=utf-8 过期:2017 年 1 月 10 日星期二 21:43:57 GMT
{ "_type": "SpellCheck", "flaggedTokens": [] }
模式:证明
请求:
发布 https://api.cognitive.microsoft.com/bing/v5.0/spellcheck/?mode=proof HTTP/1.1 内容类型:application/x-www-form-urlencoded 主机: api.cognitive.microsoft.com Ocp-Apim-Subscription-Key: ••••••••••••••••••••••••••••••••
Text=这是一个很长的句子,这里有一些错误。它应该 成为一个问题,但我想不出一个很长的问题。也许那 意思是我没有什么严肃的问题要问?
回应:
变化:接受编码 BingAPIs-TraceId: 627B24C4E6D148E1B441F29A4872942B X-MSEdge-ClientID: 33F31CBFF80462EB27B316B9F935630A X-MSAPI-用户状态:983f BingAPIs-Market: en-US X-MSEdge-Ref: Ref A: 627B24C4E6D148E1B441F29A4872942B 参考 B: 79AB388A3DFCBD481B71DB909B097DC3 参考 C:太平洋标准时间 2017 年 1 月 10 日星期二 13:46:16 apim 请求 ID:645f3de5-6823-40d1-aea6-312e10d1eee2 严格的传输安全性:max-age=31536000;包括子域; 预加载缓存控制:max-age=0,私有日期:2017 年 1 月 10 日,星期二 21:46:16 GMT P3P: CP="NON UNI COM NAV STA LOC CURa DEVa PSAa PSDa OUR IND" 内容长度:700 内容类型:应用程序/json;charset=utf-8 过期:2017 年 1 月 10 日星期二 21:45:16 GMT
{
"_type": "拼写检查",
“标记的令牌”:[
{ "offset": 15, "token": "sentance", "type": "UnknownToken", "suggestions": [ { "suggestion": "sentence", "score": 0.687877624668787 } ] }, { "offset": 86, "token": "i", "type": "UnknownToken", "suggestions": [ { "suggestion": "I", "score": 0 } ] }, { "offset": 137, "token": "i", "type": "UnknownToken", "suggestions": [ { "suggestion": "I", "score": 0 } ] }, { "offset": 52, "token": "its", "type": "UnknownToken", "suggestions": [ { "suggestion": "it's", "score": 0.830337199488689 } ] }, { "offset": 160, "token": "selious", "type": "UnknownToken", "suggestions": [ { "suggestion": "serious", "score": 0.897224156828521 }, { "suggestion": "delicious", "score": 0.687622047694618 } ] }]
}
【问题讨论】:
-
你找到答案了吗?因为我有同样的错误......谢谢
-
是的,我已将其发布在下面作为答案。拼写模式将更正长度最多为 9 个标记的查询。我得到更长的字符串,在 9 个标记的子字符串中分批,以解决这个问题
-
我明白了!谢谢!
标签: bing-api microsoft-cognitive