代码之家  ›  专栏  ›  技术社区  ›  Akusete

Light C Unicode库

  •  49
  • Akusete  · 技术社区  · 17 年前

    我在找一个小的C库来处理utf8字符串。

    具体来说,基于Unicode分隔符的拆分用于词干算法。

    相关岗位建议:

    重症监护室 http://www.icu-project.org/ (在嵌入式设备上,我发现它太笨重了)

    UTF8CPP: http://utfcpp.sourceforge.net/ (优秀,但C++没有C)

    是否有人找到任何独立于平台的小型代码库来处理Unicode字符串(不需要进行归化)。

    3 回复  |  直到 8 年前
        1
  •  33
  •   pmttavara LoveToCode    9 年前

    我成功使用的一个好的、轻的图书馆是 utf8proc .

        2
  •  15
  •   xenu    14 年前

    还有 MicroUTF-8 .

        3
  •  8
  •   Artelius    17 年前

    UTF-8是专门设计的,这样许多面向字节的字符串函数可以继续工作,或者只需要做一些小的修改。

    C氏症 strstr 例如,只要函数的两个输入都是有效的、以空结尾的utf-8字符串,函数就可以完美地工作。 strcpy 只要输入字符串从字符边界开始(例如返回值 字符串查找 )

    所以你甚至不需要单独的图书馆!