【发布时间】:2016-04-24 10:46:13
【问题描述】:
如果我有一些字符串要在 UTF-8 中搜索,而另一个要在 UTF-8 中搜索,是否有任何警告要对代码点进行直接比较搜索以查明匹配字符?
使用 UTF-8 的工作方式,是否有可能出现误报?
我已经阅读了很多关于 UTF-8 有多棒的文档,但我无法形成一个证据来回答这个问题。
如果我向前搜索,那么我可以跳过代码点的长度;但它让我很担心。
与其向后走直到找到代码点的开头,然后从该地址进行内存比较,不如简单地沿着每个字节向后走,直到与搜索字符串完全匹配?
【问题讨论】:
标签: c++ unicode encoding utf-8 unicode-string