小编Hit*_*anA的帖子

如何从字符串中删除\n和\ r \n

我目前正在尝试从这个网站获取代码:http://netherkingdom.netai.net/pycake.html 然后我有一个python脚本解析出html div标签中的所有代码,最后从div标签之间写入文本到一个文件.问题是它为文件添加了一堆\ r和\n.如何避免这种情况或删除\ r和\n.这是我的代码:

import urllib.request
from html.parser import HTMLParser
import re
page = urllib.request.urlopen('http://netherkingdom.netai.net/pycake.html')
t = page.read()
class MyHTMLParser(HTMLParser):
    def handle_data(self, data):
        print(data)
        f = open('/Users/austinhitt/Desktop/Test.py', 'r')
        t = f.read()
        f = open('/Users/austinhitt/Desktop/Test.py', 'w')
        f.write(t + '\n' + data)
        f.close()
parser = MyHTMLParser()
t = t.decode()
parser.feed(t)
Run Code Online (Sandbox Code Playgroud)

这是它产生的结果文件:

b'
import time as t\r\n
from os import path\r\n
import os\r\n
\r\n
\r\n
\r\n
\r\n
\r\n'
Run Code Online (Sandbox Code Playgroud)

我最好还是先删除b'和last'.我在Mac上使用Python 3.5.1.

html python file-writing python-3.x

13
推荐指数
1
解决办法
5万
查看次数

标签 统计

file-writing ×1

html ×1

python ×1

python-3.x ×1