我想提取一个大字符串的一部分.在之前和之后的单词数量上有一个目标单词和一个上限.因此,提取的子字符串必须包含目标字以及它之前和之后的上限字.如果目标单词更接近文本的开头或结尾,则前后部分可以包含较少的单词.
Eample字符串
"Lorem ipsum dolor sit amet,consectetur adipiscing elit,sed do eiusmod tempor incididunt ut labore et dolore magna aliqua.Ut enim ad minim veniam,quis nostrud exercitation ullamco laboris nisi ut aliquip ex ea commodo consequat.Duis aute irure dolor in rephenderit in voluptate velit esse cillum dolore eu fugiat nulla pariatur.Excepteur sint occaecat cupidatat non proident,sunt in culpa qui officia deserunt mollit anim id est laborum."
目标词: 劳动力
words_before: 5
words_after: 2
应该回来 ['veniam, quis nostrud exercitation ullamco laboris nisi ut']
我想到了几种可能的模式,但没有一种有效.我想也可以通过简单地从目标单词前后遍历字符串来完成.然而,正则表达式肯定会让事情变得更容易.任何帮助,将不胜感激.
对我来说,PyDub 库非常适合转换音频格式。我最近用它编写了一个命令行音频转换器来转换大约 200 个音频文件,它使我不必购买或寻找一个音频转换器,让我可以将歌曲和其他音频文件排队转换。但我很快注意到它取代了我的音频文件。现在,对我来说,这是理想的。这太棒了。但是,如果我不希望PyDub 替换音频文件,而是以不同的格式复制它呢?我可以将文件复制到目录中并进行转换,但是在 PyDub 中没有办法做到这一点吗?我查看了它,但找不到方法来做到这一点,也找不到关于此的问题,所以也许这不是一件很常见的事情。
谢谢!