搜狗输入法最近的用户输入中出现了一种新的输入模式,形如 “0k1234567”,搜狗的工程师发现这一模式后了解到,这是一种新被提出的对于十五进制数字的标记模式,其中 “0k” 是标记进制为15的前缀标记,之后的部分 “1234567” 是实际的十五进制的数字串。
在发现这一标记模式后,搜狗的工程师开始尝试在已有的分词算法上进一步加入对于十五进制数字串的处理,把网页上的这种形式的 15 进制数正确地提取出来。我们知道,标记十五进制的 “0k” 中 k 必须是小写,数字 0 到 14 在这套标记模式下会被依次表示为:0k0, 0k1, ..., 0k9, 0kA, 0kB, 0kC, 0kD, 0kE。也就是说 15 进制数字中

本文介绍了搜狗输入法针对用户输入的新型15进制标记模式,如"0k1234567",解析其分词规则,包括"0k"作为15进制前缀,以及15进制数字的表示范围和格式。重点在于正确提取符合模式的15进制数,并遵循特定的输出顺序。

2万+

被折叠的 条评论
为什么被折叠?



