【发布时间】:2015-06-10 22:14:03
【问题描述】:
如何拆分二进制 Erlang 字符串,将其数据视为 UTF8 字符?
假设我们有一个二进制文件,它应该被分成两部分,第一部分应该包含前两个 UTF8 字符。下面是几个例子:<<"ąčęė">> 应该变成[<<"ąč">>, <<"ęė">>]
<<"あぁぅうぁ">> 应该变成[<<"あぁ">>, <<"ぅうぁ">>]
【问题讨论】:
-
对不起,我不明白你想得到什么结果?
-
我正在寻找一种基于字符数而不是字节数来拆分二进制 UTF8 字符串的方法。
标签: string utf-8 binary erlang