我正在尝试理解C++的某些方面.
我编写了这个简短的程序来展示从C++函数返回对象的不同方法:
#include <iostream>
using namespace std;
// A simple class with only one private member.
class Car{
private:
int maxSpeed;
public:
Car( int );
void print();
Car& operator= (const Car &);
Car(const Car &);
};
// Constructor
Car::Car( int maxSpeed ){
this -> maxSpeed = maxSpeed;
cout << "Constructor: New Car (speed="<<maxSpeed<<") at " << this << endl;
}
// Assignment operator
Car& Car::operator= (const Car &anotherCar){
cout << "Assignment operator: copying " << &anotherCar << " into " …Run Code Online (Sandbox Code Playgroud) 在所有dbpedia页面中,例如
http://dbpedia.org/page/Ireland
有一个RDF文件的链接.在我的应用程序中,我需要分析rdf代码并在其上运行一些逻辑.我可以依赖于dbpedia SPARQL端点,但我更喜欢在本地下载rdf代码并解析它,以完全控制它.
我安装了JENA,我正在尝试解析代码并提取一个名为"geo:geometry"的属性.
我正在尝试:
StringReader sr = new StringReader( node.rdfCode )
Model model = ModelFactory.createDefaultModel()
model.read( sr, null )
Run Code Online (Sandbox Code Playgroud)
如何查询模型以获取我需要的信息?
例如,如果我想获得声明:
<rdf:Description rdf:about="http://dbpedia.org/resource/Ireland">
<geo:geometry xmlns:geo="http://www.w3.org/2003/01/geo/wgs84_pos#" rdf:datatype="http://www.openlinksw.com/schemas/virtrdf#Geometry">POINT(-7 53)</geo:geometry>
</rdf:Description>
Run Code Online (Sandbox Code Playgroud)
要么
<rdf:Description rdf:about="http://dbpedia.org/resource/Ireland">
<dbpprop:countryLargestCity xmlns:dbpprop="http://dbpedia.org/property/" xml:lang="en">Dublin</dbpprop:countryLargestCity>
</rdf:Description>
Run Code Online (Sandbox Code Playgroud)
什么是正确的过滤器?
非常感谢!Mulone
我在区间[0,1]中有2个45个值的系列.第一个系列是人工生成的标准,第二个系列是计算机生成的(完整系列在这里http://www.copypastecode.com/74844/).第一个系列逐渐排序.
0.909090909 0.216196598
0.909090909 0.111282099
0.9 0.021432587
0.9 0.033901106
...
0.1 0.003099256
0 0.001084533
0 0.008882249
0 0.006501463
Run Code Online (Sandbox Code Playgroud)
现在我要评估的是第二个系列中订单保留的程度,因为第一个系列是单调的.该Pearson相关是0.454763067,但我认为我们之间的关系不是线性的,所以这个值是难以解释.
一种自然的方法是使用Spearman等级相关,在这种情况下是0.670556181.我注意到随机值,当Pearson非常接近0时,Spearman等级相关性上升到0.5,所以0.67的值似乎非常低.
您将使用什么来评估这两个系列之间的顺序相似性?
我在R中有一个大的,方形的稀疏矩阵(大约30M实数),我希望看到它的值的分布.如果我使用hist函数,因为大多数值都是0,我得到一个非常高的第一个条,然后是非常接近0的非常长的尾部,类似于:I_ _ ____
所以我想我应该只打印非零值,或重新调整值,以便以一种有意义的方式显示非零值的模式.有没有办法告诉hist过滤掉某些值?我想只在(0,1)中包含值.
我正在使用browser()调试R代码.该函数暂停当前R脚本的执行并允许检查.是否可以在执行期间动态启用/禁用调试模式?使用大型脚本将非常方便.
谢谢
我想知道R中用于计算Spearman rho的cor.test函数是否进行了纠正.我在官方的R文档中找不到直接的答案.
领带纠正斯皮尔曼的一个例子见:
Cureton,Edward E.当存在关系时,平均spearman等级标准相关性.Psychometrika 23,没有.3(1958年9月):271-272.
感谢任何提示,Mulone
我正在使用JUNG2绘制一些图表.
这是我得到的图像:http: //img841.imageshack.us/img841/205/graphvizkk3312164f020b4.png
我想:
1)更改渲染顺序(标签应该是要绘制的最后一个对象);
2)在标签上添加半透明背景.
3)改变整个图像的背景颜色.
有关如何做到这一点的任何想法?JUNG2文档在这些问题上并不十分广泛.
Mulone
众所周知,R不是运行大型分析的最有效平台.如果我有一个包含三个参数的大型数据框:
GROUP X Y
A 1 2
A 2 2
A 2 3
...
B 1 1
B 2 3
B 1 4
...
millions of rows
Run Code Online (Sandbox Code Playgroud)
我想在每个组上运行计算(例如,在X,Y上计算Pearson的r)并将结果存储在一个新的数据框中,我可以这样做:
df = loadDataFrameFrom( someFile )
results = data.frame()
for ( g in unique( df$GROUP)) ){
gdf <- subset( df, df$GROUP == g )
partialRes <- slowStuff( gdf$X,gdf$Y )
results = rbind( results, data.frame( GROUP = g, RES = partialRes ) )
}
// results contains all the results here.
useResults(results)
Run Code Online (Sandbox Code Playgroud)
显而易见的问题是,即使在强大的多核机器上,这也非常慢.
我的问题是:是否可以并行化这种计算,例如为每个组或一组组创建一个单独的线程?是否有一个干净的R模式来解决这个简单的除法和问题? …