R中的两个数据帧都包含IP地址字段.在每个数据帧中,这些字段是"因子".用户打算基于这些IP地址以及一些其他字段合并两个数据帧.问题是每个数据帧都有不同的IP格式:
Dataframe A examples: 123.456.789.123, 123.012.001.123, 987.001.010.100
Run Code Online (Sandbox Code Playgroud)
Dataframe B中的相同IP格式为:
Dataframe B examples: 123.456.789.123, 123.12.1.123, 987.1.10.100
Run Code Online (Sandbox Code Playgroud)
从A中删除前导零或将它们添加到B以便它们可以在合并中使用的最佳(最有效)方法是什么?该操作将在数百万条记录上执行,因此"最有效"是考虑到计算时间(需要相对较快).
在sqlalchemy(postgresqlDB)中,我想创建一个有界和函数,因为缺少一个更好的术语.目标是在定义的范围内创建运行总计.
目前,我有一些非常适合计算没有边界的运行总计的东西.像这样的东西:
from sqlalchemy.sql import func
foos = (
db.query(
Foo.id,
Foo.points,
Foo.timestamp,
func.sum(Foo.points).over(order_by=Foo.timestamp).label('running_total')
)
.filter(...)
.all()
)
Run Code Online (Sandbox Code Playgroud)
但是,我希望能够将这个运行总数限制在一个特定的范围内,比如说[-100, 100].所以我们会得到这样的东西(见running_total):
{'timestamp': 1, 'points': 75, 'running_total': 75}
{'timestamp': 2, 'points': 50, 'running_total': 100}
{'timestamp': 3, 'points': -100, 'running_total': 0}
{'timestamp': 4, 'points': -50, 'running_total': -50}
{'timestamp': 5, 'points': -75, 'running_total': -100}
Run Code Online (Sandbox Code Playgroud)
有任何想法吗?
此外,允许以可读/简单的方式处理长行,编写它们以及读取它们.
我已经研究过,opencsv但它没有以任何顺序的方式引用行中的元素,并且supercsv不允许按名称查看列,而只是查看数字.
另一个警告 - 我需要能够按名称来处理列 - 是列的数量不是常量,并且只有部分列标题是常量,如:
Name|Number|Color1|Color2......|Color67|
Run Code Online (Sandbox Code Playgroud)
并非任何给定的CSV文件中都存在1到67之间的所有颜色.
我有一个java外观类,我试图从python访问,所以我决定使用JPype.我的facade类只有一个带有四个args的构造函数(没有默认值)
public facade(String a, String b, List<String> c, List<String> d){
...
}
Run Code Online (Sandbox Code Playgroud)
在初始化类的新实例时,我似乎无法使类型正确.我尝试的一切都给出了同样的错误:
File ".../main.py", line 34, in __init__
facadeinstance = Facade(jpype.JString(s1), jpype.JString(s2),jpype.JArray(jpype.java.lang.String, 1)(s3), jpype.JArray(jpype.java.lang.String, 1)(s4))
File "/usr/local/lib/python2.7/dist-packages/jpype/_jclass.py", line 79, in _javaInit
self.__javaobject__ = self.__class__.__javaclass__.newClassInstance(*args)
RuntimeError: No matching overloads found. at src/native/common/jp_method.cpp:121
Run Code Online (Sandbox Code Playgroud)
我知道JPype有效.我已经尝试了几种包装器组合,以正确的形式获取数据而没有运气.
相关代码:
import jpype
s1 = "something"
s2 = "something else"
s3 = ["something in a list"]
s4 = ["Something else in a list"]
jpype.startJVM(jpype.getDefaultJVMPath(), "-Djava.class.path=" + JavaJarDir)
myLib = jpype.JPackage('myLib')
Facade = myLib.Facade …Run Code Online (Sandbox Code Playgroud) 我希望能够子集我data.frame,DATA入数字字段和要素类型字段.我的目标是编写通用脚本来汇总我的数据,但是,某些函数(如hist或quantile)不适用于非数字数据.在因子类型字段上运行表会更有意义.
我试过用
types <- apply( DATA, 2, typeof)
Run Code Online (Sandbox Code Playgroud)
为每个字段创建一个类型列表,然后我可以将其分组DATA.但是,这只会导致错误.我确信有一种简单的方法可以做到这一点,但我已经做了很多搜索,无法想出任何东西.
谢谢.
我正在使用bitnami AMI(确切地说是ami-8333ffea)在微型EC2实例上运行wordpress,但我认为此问题适用于任何bitnami云应用程序。我已经指定了一个弹性IP并将一个子域映射到该实例(例如blog.example.com)。到目前为止,一切都很好。
现在,我可以访问该博客,但所有URL都包含“ /wordpress”(blog.example.com/wordpress/.../)。Bitnami有文档(单击“ Cloud Image / Bitnami Hoting”选项卡)来解决此问题,但我尝试了几次,但均未成功。我进行了更改,该站点仍然可以运行,但是“ / wordpress”仍然在嘲笑我。该机器正在运行Apache2,并且所有说明似乎都有意义。我不确定自己在做什么错。请帮忙。
java ×2
python ×2
r ×2
amazon-ec2 ×1
apache2 ×1
bitnami ×1
csv ×1
ip ×1
jpype ×1
postgresql ×1
sqlalchemy ×1
supercsv ×1
wordpress ×1