小编hoj*_*oju的帖子

找到列表中最常见的元素

查找Python列表中最常见元素的有效方法是什么?

我的列表项可能不具有哈希值,因此无法使用字典.同样在绘制的情况下,应返回具有最低索引的项目.例:

>>> most_common(['duck', 'duck', 'goose'])
'duck'
>>> most_common(['goose', 'duck', 'duck', 'goose'])
'goose'
Run Code Online (Sandbox Code Playgroud)

python list

158
推荐指数
9
解决办法
22万
查看次数

使用VIM中的大文件

我尝试在VIM中打开一个巨大的(~2GB)文件但是它很窒息.我实际上不需要编辑文件,只是有效地跳转.

如何在VIM中处理非常大的文件?

vim large-files

106
推荐指数
5
解决办法
13万
查看次数

提取正则表达式匹配的一部分

我想要一个正则表达式从HTML页面中提取标题.目前我有这个:

title = re.search('<title>.*</title>', html, re.IGNORECASE).group()
if title:
    title = title.replace('<title>', '').replace('</title>', '') 
Run Code Online (Sandbox Code Playgroud)

是否有正则表达式只提取<title>的内容,所以我不必删除标签?

html python regex html-content-extraction

104
推荐指数
6
解决办法
13万
查看次数

Javascript:将舍入数字格式化为N个小数

在JavaScript中,将数字舍入到N个小数位的典型方法是:

function roundNumber(num, dec) {
  return Math.round(num * Math.pow(10, dec)) / Math.pow(10, dec);
}
Run Code Online (Sandbox Code Playgroud)

然而,这种方法将舍入到最多 N个小数位,而我想要总是舍入到N个小数位.例如,"2.0"将四舍五入为"2".

有任何想法吗?

javascript math decimal-point rounding

100
推荐指数
7
解决办法
13万
查看次数

下载网页和依赖项,包括css图像

我经常需要下载一个网页,然后离线编辑它.我尝试了一些工具,他们缺少的主要功能是下载CSS文件中引用的图像.

是否有一个工具(用于Linux)将下载所有内容,以便网页将呈现相同的离线(不包括AJAX)?

html css image download

68
推荐指数
5
解决办法
6万
查看次数

访问ElementTree节点父节点

我正在使用内置的Python ElementTree模块.访问子节点很简单,但父节点或兄弟节点呢? - 这可以在不遍历整棵树的情况下有效地完成吗?

python elementtree

55
推荐指数
6
解决办法
5万
查看次数

使用urllib2将大型二进制文件流式传输到文件

我使用以下代码将大型文件从Internet流式传输到本地文件:

fp = open(file, 'wb')
req = urllib2.urlopen(url)
for line in req:
    fp.write(line)
fp.close()
Run Code Online (Sandbox Code Playgroud)

这有效,但下载速度很慢.有更快的方法吗?(文件很大,所以我不想把它们留在内存中.)

python streaming file urllib2

53
推荐指数
3
解决办法
5万
查看次数

用Python原子写入文件

我使用Python在一个操作中将文本块写入文件:

open(file, 'w').write(text)
Run Code Online (Sandbox Code Playgroud)

如果脚本被中断,那么文件写入没有完成我想要没有文件而不是部分完整的文件.可以这样做吗?

python file-io atomic

52
推荐指数
5
解决办法
3万
查看次数

在Windows命令提示符下使用ssh

问题: 如何在Windows命令提示符下使用ssh和scp?

我记得我过去安装了一个程序让我这样做但现在不记得是什么了.

注意: 我不想使用putty.

windows ssh cmd scp

51
推荐指数
3
解决办法
23万
查看次数

如何从URL中提取顶级域名(TLD)

如何从URL中提取域名,不包括任何子域名?

我最初的简单尝试是:

'.'.join(urlparse.urlparse(url).netloc.split('.')[-2:])
Run Code Online (Sandbox Code Playgroud)

这适用于http://www.foo.com,但不适用于http://www.foo.com.au.有没有办法在不使用有关有效TLD(顶级域名)或国家/地区代码(因为它们发生变化)的特殊知识的情况下正确执行此操作.

谢谢

python dns url parsing extract

49
推荐指数
4
解决办法
6万
查看次数