Python - 解码还是正则表达式?

dat*_*den 2 python regex unicode

dict从网上抓了这个,但它附带了这个unicode问题:

{'track': [u'\u201cAnxiety\u201d',
           u'\u201cLockjaw\u201d [ft. Kodak Black]',
           u'\u201cMelanin Drop\u201d',
           u'\u201cDreams\u201d',
           u'\u201cIntern\u201d',
           u'\u201cYou Don\u2019t Think You Like People Like Me\u201d',
           u'\u201cFirst Day Out tha Feds\u201d',
           u'\u201cFemale Vampire\u201d',
           u'\u201cGirlfriend\u201d',
           u'\u201cOpposite House\u201d',
           u'\u201cGirls @\u201d [ft. Chance the Rapper]',
           u'\u201cI Am a Nightmare\u201d']}
Run Code Online (Sandbox Code Playgroud)

剥离这些字符的最佳方法是使用regex,还是有一些decode方法?

如何?

zvo*_*one 5

这些是引号("和").如果你只是想在字符串的开头或结尾摆脱它们,对他们来说这是最容易的strip.

>>> u'\u201cAnxiety\u201d'.strip(u'\u201c\u201d')
u'Anxiety'
Run Code Online (Sandbox Code Playgroud)

如果你想在字符串中的任何地方摆脱它们,replace它们:

>>> u'\u201cAnxiety\u201d'.replace(u'\u201c', '').replace(u'\u201d', '')
u'Anxiety'
Run Code Online (Sandbox Code Playgroud)

  • 或者你可以用常规引号代替:'u'\ u201cAnxiety\u201d'.replace(u'\ u201c','"').replace(u'\ u201d','"') (2认同)