dat*_*den 2 python regex unicode
我dict从网上抓了这个,但它附带了这个unicode问题:
{'track': [u'\u201cAnxiety\u201d',
u'\u201cLockjaw\u201d [ft. Kodak Black]',
u'\u201cMelanin Drop\u201d',
u'\u201cDreams\u201d',
u'\u201cIntern\u201d',
u'\u201cYou Don\u2019t Think You Like People Like Me\u201d',
u'\u201cFirst Day Out tha Feds\u201d',
u'\u201cFemale Vampire\u201d',
u'\u201cGirlfriend\u201d',
u'\u201cOpposite House\u201d',
u'\u201cGirls @\u201d [ft. Chance the Rapper]',
u'\u201cI Am a Nightmare\u201d']}
Run Code Online (Sandbox Code Playgroud)
剥离这些字符的最佳方法是使用regex,还是有一些decode方法?
如何?
这些是引号("和").如果你只是想在字符串的开头或结尾摆脱它们,对他们来说这是最容易的strip.
>>> u'\u201cAnxiety\u201d'.strip(u'\u201c\u201d')
u'Anxiety'
Run Code Online (Sandbox Code Playgroud)
如果你想在字符串中的任何地方摆脱它们,replace它们:
>>> u'\u201cAnxiety\u201d'.replace(u'\u201c', '').replace(u'\u201d', '')
u'Anxiety'
Run Code Online (Sandbox Code Playgroud)