|
|
1
14
现在您有了一个包含西里尔字母的普通Unicode字符串。
请注意,您的Latin-1 misencoded字符串可能实际上是Windows代码页1252 misencoded字符串;我无法从给定的示例中判断,因为它没有使用两种编码之间任何不同的字符。如果是这种情况,请使用
此外,这还假设是数据库的内容出错。如果数据库是 想象上的 要存储UTF-8字符串,但要将它们像拉丁语-1(或代码页1252,因为它是系统代码页)一样拉出,那么实际上需要重新配置数据访问层以设置正确的编码。如果您使用的是SQL Server,最好开始使用NVARCHAR。 |
|
|
2
1
我使用的是sql server,所有列都是nvarchar。数据是通过mysql转储从latin1而不是utf8的数据库导入的。所以所有的unicode字符串都是简单的拉丁1编码。不管怎样,我想出来了,它和你的建议非常相似。下面是我将拉丁文编码的utf8转换成1251的步骤。
|
|
|
stack programming · 如何将损坏的文本恢复为阿拉伯语 2 年前 |
|
|
FoolishMortal · 无法显示从基64字符串解码的特定图像 2 年前 |
|
|
xchrisbradley · 使用Zig签名对功能选择器进行编码 2 年前 |
|
|
dax · 运行长度编码给出错误的结果 2 年前 |
|
Ben · 内存中的Python GZIP在现有文件上 2 年前 |
|
|
GoodCat · 如何将这64行缩短4个字符? 2 年前 |