小编Jas*_*ram的帖子

scipy连接格式

我已经编写了自己的聚类程序,并希望生成一个树形图.最简单的方法是使用scipy树形图函数.但是,这要求输入的格式与scipy linkage函数产生的格式相同.我找不到如何格式化输出的示例.我想知道是否有人可以启发我.

python dendrogram scipy

34
推荐指数
3
解决办法
2万
查看次数

使用HTML5,如何在表单提交中使用contenteditable字段?

所以我有一堆段落元素,它们是从db动态填充的.我已经使元素满足.我现在想通过标准表单提交来编辑数据库.有没有办法将可疑元素发回?

html5 contenteditable

33
推荐指数
1
解决办法
2万
查看次数

转换:Postscript委托失败

我想将PDF转换为JPEG:

$ convert pdf-test.pdf pdf-test.pdf.jpg
Run Code Online (Sandbox Code Playgroud)

但是,我收到此错误:

convert: Postscript delegate failed `pdf-test.pdf': No such file or directory @ error/pdf.c/ReadPDFImage/664.
convert: missing an image filename `pdf-test.pdf.jpg' @ error/convert.c/ConvertImageCommand/3015.
Run Code Online (Sandbox Code Playgroud)

目前我在Mac OS X Lion上使用此版本的GS和ImageMagick:

$ gs -v
GPL Ghostscript 9.02 (2011-03-30)
Copyright (C) 2010 Artifex Software, Inc.  All rights reserved.

$ convert -version
Version: ImageMagick 6.7.1-1 2011-07-21 Q16 http://www.imagemagick.org
Copyright: Copyright (C) 1999-2011 ImageMagick Studio LLC
Features: OpenMP
Run Code Online (Sandbox Code Playgroud)

有人可以开导我这个吗?

pdf jpeg postscript imagemagick ghostscript

33
推荐指数
3
解决办法
3万
查看次数

快速的Haversine逼近(Python/Pandas)

Pandas数据帧中的每一行包含2个点的lat/lng坐标.使用下面的Python代码,计算许多(数百万)行的这两个点之间的距离需要很长时间!

考虑到2点相距不到50英里并且准确性不是很重要,是否可以更快地进行计算?

from math import radians, cos, sin, asin, sqrt
def haversine(lon1, lat1, lon2, lat2):
    """
    Calculate the great circle distance between two points 
    on the earth (specified in decimal degrees)
    """
    # convert decimal degrees to radians 
    lon1, lat1, lon2, lat2 = map(radians, [lon1, lat1, lon2, lat2])
    # haversine formula 
    dlon = lon2 - lon1 
    dlat = lat2 - lat1 
    a = sin(dlat/2)**2 + cos(lat1) * cos(lat2) * sin(dlon/2)**2
    c = 2 * asin(sqrt(a)) 
    km = 6367 * c …
Run Code Online (Sandbox Code Playgroud)

python gis numpy haversine pandas

31
推荐指数
4
解决办法
2万
查看次数

Javascript和C#中var的实现差异

我想问一个理论问题.例如,如果我有Page_load中的以下C#代码:

cars = new carsModel.carsEntities();

var mftQuery = from mft in cars.Manufacturers 
               where mft.StockHeaders.Any(sh=> sh.StockCount>0) 
               orderby mft.CompanyName 
               select new {mft.CompanyID, mft.CompanyName};
               // ...
Run Code Online (Sandbox Code Playgroud)

问题:

  1. 此代码使用var关键字.这种结构有什么好处?
  2. var在Javascript和C#中实现的关键区别是什么?

.net javascript c# linq var

30
推荐指数
3
解决办法
6255
查看次数

使用python和networkx进行大图形可视化

我在python和networkx中遇到大图形可视化问题.图形希望可视化是有向的,并且边缘和顶点集大小为215,000.从文档(在首页链接)可以清楚地看出,networkx支持使用matplotlib和GraphViz进行绘图.在matplotlib和networkx中,绘图完成如下:

import 
networkx as nx
import matplotlib.pyplot as plt
#Let g be a graph that I created
nx.draw(g)
Run Code Online (Sandbox Code Playgroud)

之后我会收到一个内存错误nx.draw(g),之后您通常会执行plt.show()或尝试[some_function]以高效等格式保存文件.

接下来我尝试了GraphViz.从维基百科页面,dot格式用于有向图,我创建了一个点文件:

nx.write_dot(g, "g.dot")
Run Code Online (Sandbox Code Playgroud)

这很好用,我在当前目录中有一个12兆字节的点文件.接下来我运行dot程序(graphviz的一部分来创建postscript文件):

dot -Tps g.dot -o g.ps
Run Code Online (Sandbox Code Playgroud)

这会减慢我的电脑速度,运行几分钟然后显示Killed在终端中.因此它永远无法执行......在阅读graphviz的文档时,似乎只有无向图才能支持大图形可视化.

问题:有了这两个不成功的尝试,任何人都可以告诉我如何使用python和networkx可视化我的大图,大约215,000个顶点和215,000个边缘?我怀疑与Graphviz一样,我必须输出一个中间格式(虽然这不应该那么难,它不会像内置函数那么容易)然后使用另一个工具来读取中间格式然后输出一个可视化.

所以,我正在寻找以下内容:

  1. 从networkx输出图形为中间格式
  2. 使用新的软件包/软件/工具(理想情况下是python-interactive)读取中间格式并可视化大图

如果您需要更多信息,请告诉我们!

python visualization data-visualization networkx

30
推荐指数
1
解决办法
2万
查看次数

pandas dataframe对象是否可以与sklearn kmeans聚类一起使用?

数据集是pandas数据帧.这是sklearn.cluster.KMeans

 km = KMeans(n_clusters = n_Clusters)

 km.fit(dataset)

 prediction = km.predict(dataset)
Run Code Online (Sandbox Code Playgroud)

这就是我如何决定哪个实体属于哪个集群:

 for i in range(len(prediction)):
     cluster_fit_dict[dataset.index[i]] = prediction[i]
Run Code Online (Sandbox Code Playgroud)

这就是数据集的外观:

 A 1 2 3 4 5 6
 B 2 3 4 5 6 7
 C 1 4 2 7 8 1
 ...
Run Code Online (Sandbox Code Playgroud)

其中A,B,C是指数

这是使用k-means的正确方法吗?

python cluster-analysis k-means pandas scikit-learn

30
推荐指数
2
解决办法
4万
查看次数

最佳地聚类一维数据?

有没有人有一篇论文解释了Ckmeans.1d.dp算法是如何工作的?

或者:在一维中进行k均值聚类的最佳方法是什么?

r cluster-analysis k-means cran

28
推荐指数
1
解决办法
3万
查看次数

multiprocessing.Pool示例

我正在尝试学习如何使用多处理,并找到以下示例.

我想总结如下值:

from multiprocessing import Pool
from time import time

N = 10
K = 50
w = 0

def CostlyFunction(z):
    r = 0
    for k in xrange(1, K+2):
        r += z ** (1 / k**1.5)
    print r
    w += r
    return r

currtime = time()

po = Pool()

for i in xrange(N):
    po.apply_async(CostlyFunction,(i,))
po.close()
po.join()

print w
print '2: parallel: time elapsed:', time() - currtime
Run Code Online (Sandbox Code Playgroud)

我无法得到所有r值的总和.

python multiprocessing

25
推荐指数
2
解决办法
6万
查看次数

具有contenteditable = true的div可以通过表单传递吗?

可以<div contenteditable="true"><a href="page.html">Some</a> Text</div>用来代替texarea,然后以某种方式通过槽形式?

理想情况下没有JS

html html5

25
推荐指数
1
解决办法
3万
查看次数