我在Matplotlib中显示非ASCII字符时出现问题,这些字符呈现为小方块而不是正确的字体,它看起来像(我用红色涂料填充这些框以高亮显示它们):

我如何解决它?
相关问题是Matplotlib中的重音字符.
我遇到了matplotlib用来表示ticklabels的Text对象的问题.
出于测试原因,我需要检查在绘图中创建的刻度标签的值.如果标签是字符串或正数,则没有问题:返回一个unicode字符串,我测试它(或根据情况将其转换为数字),一切都很好.
但是如果标签是负数,我得到的是一个错误的unicode字符串,这是我无法理解的原因.
我们来看看这个示例代码:
import pylab as plt
fig, ax = plt.subplots(1)
ax.plot([-1, 0, 1, 2], range(4))
labels = ax.get_xticklabels()
Run Code Online (Sandbox Code Playgroud)
现在,如果我问第二个标签的文本内容(0),我获得了一个正常的unicode字符串:
labels[1].get_text()
# u'0.0'
Run Code Online (Sandbox Code Playgroud)
但是第一个(the -1)的unicode 是一个奇怪的事情
labels[1].get_text()
# u'\u22121'
Run Code Online (Sandbox Code Playgroud)
这是在终端中正确打印的,但在这种情况下,我需要用数值来对付它,并且每次转换都会失败,无论是int和float.
我尝试将其转换为UTF-8字符串
text = labels[1].get_text()
text.encode('utf8')
# '\xe2\x88\x921'
Run Code Online (Sandbox Code Playgroud)
但同样,它是正确打印的东西,并在转换时引发错误.我也查看了unicodedata模块,但看起来它只能转换单个字符,所以在这种情况下是没用的.我也尝试使用unicodedata.normalize和任何可能的格式规范化字符串,但再次没有成功.
我移动到pipy模块unidecode(如Python和字符规范化中所建议的那样),再次没有任何成功
from unidecode import unidecode
unidecode(text)
# '[?]1'
Run Code Online (Sandbox Code Playgroud)
我也试图在Matplotlib中使用非ASCII字符的解决方案来避免字体问题,但结果相同(我不确定它是否应该做些什么,这是一个可视化的问题......).问题Matplotlib中的Accented字符有一个类似的问题,因为它关注的是可视化而不是它本身的价值
我开始觉得有点迷失......我知道python 2.7有一些unicode"难度",但通常我可以用某种方式避免它们.
我知道问题是减号,因为我可以通过粗暴的替代罪魁祸首来避免这个问题:
text.replace(u'\u2212', '-')
# u'-1'
Run Code Online (Sandbox Code Playgroud)
但这比解决方案更多,更黑,而且我几乎可以肯定它在不同的系统中并不稳定,所以我希望更接近解决方案.
我正在和我一起工作 …