dno*_*len 9 python url parsing
我很好奇是否有更简单的方法从网址中删除特定参数.我想出的是以下内容.这看起来有点冗长.使用的图书馆或更加pythonic版本赞赏.
parsed = urlparse(url)
if parsed.query != "":
params = dict([s.split("=") for s in parsed.query.split("&")])
if params.get("page"):
del params["page"]
url = urlunparse((parsed.scheme,
None,
parsed.path,
None,
urlencode(params.items()),
parsed.fragment,))
parsed = urlparse(url)
Run Code Online (Sandbox Code Playgroud)
Mar*_*tos 10
使用urlparse.parse_qsl()破解的查询字符串.您可以一次过滤:
params = [(k,v) for (k,v) in parse_qsl(parsed.query) if k != 'page']
Run Code Online (Sandbox Code Playgroud)
我已经创建了一个小帮助类来以结构化的方式表示一个url:
import cgi, urllib, urlparse
class Url(object):
def __init__(self, url):
"""Construct from a string."""
self.scheme, self.netloc, self.path, self.params, self.query, self.fragment = urlparse.urlparse(url)
self.args = dict(cgi.parse_qsl(self.query))
def __str__(self):
"""Turn back into a URL."""
self.query = urllib.urlencode(self.args)
return urlparse.urlunparse((self.scheme, self.netloc, self.path, self.params, self.query, self.fragment))
Run Code Online (Sandbox Code Playgroud)
然后你可以这样做:
u = Url(url)
del u.args['page']
url = str(u)
Run Code Online (Sandbox Code Playgroud)
更多关于此:Web开发的问题.