【发布时间】:2020-02-29 06:48:16
【问题描述】:
编辑 2:
const tamilRegex = XRegExp("\\p{Tamil}", "ug")
const match = XRegExp.exec(word, tamilRegex);
return match
现在,我发现 XRegExp 是一个可以处理 unicode 字符的库。上面的代码是我尝试使用该库的代码,但它仍然返回错误的值。
有什么帮助吗?!
编辑 1:
const word = "யாத்திராகமம்"
const firstLetter = word.match(/[^\w]/u)
console.log(firstLetter)
上面的代码返回ய,这不是该单词中正确的第一个泰米尔字母,而应该是யா。
有什么方法可以使用正则表达式或任何其他库来获取单词中正确的首字母?
【问题讨论】:
-
查找泰米尔语 unicode 中的字母列表,然后使用循环与它们进行比较。
-
word.match(/^p{L}/u),查看这个库:xregexp.com -
@James_22 是的,你是对的。但这将是重新发明轮子。我希望已经有解决方案了。如果没有,将与您的解决方案一起使用。感谢您的回复。
-
@Alex 我已经更新了我的问题。请你再检查一次。我尝试了 XRegExp 库,但我不知道如何为它正确编写正则表达式。你能帮忙吗?
-
其实问题是第一个字母是ய,不是யா。 யா是一个由辅音ய்和元音ஆ组成的音节:fr.wiktionary.org/wiki/%E0%AE%AF%E0%AE%BE
标签: javascript regex unicode tamil xregexp