小编Sta*_*cey的帖子

重塑数据帧以与另一个数据帧具有相同的索引

我有两个数据框:

dayData


        power_comparison      final_average_delta_power calculated_power
1                    0.0               0.0                  0       
2                    0.0               0.0                  0           
3                    0.0               0.0                  0           
4                    0.0               0.0                  0       
5                    0.0               0.0                  0           
7                    0.0               0.0                  0           
Run Code Online (Sandbox Code Playgroud)

historicPower

   power
0    0.0
1    0.0
2    0.0
3   -1.0
4    0.0
5    1.0
7    0.0
Run Code Online (Sandbox Code Playgroud)

我正在尝试重新索引historicPower数据框以使其具有与数据框相同的形状dayData(因此在本例中它看起来像):

   power

1    0.0
2    0.0
3   -1.0
4    0.0
5    1.0
7    0.0
Run Code Online (Sandbox Code Playgroud)

现实中的数据框会更大,具有不同的形状。

python indexing dataframe pandas reindex

2
推荐指数
1
解决办法
1658
查看次数

两个整数之间的正则表达式

我正在尝试构建一个正则表达式,将该单词mark与大于或等于140000且小于或等于150000的整数相匹配.

因此,例如,最小值将是mark_140000最大值,最大值将是mark_150000.值mark_139999mark_150001将是无效的.

我有一个匹配从140000到149999的方法:

"^mark_14[0-9]{4}$"
Run Code Online (Sandbox Code Playgroud)

我怎样才能获得150000的最大值?

python regex

2
推荐指数
1
解决办法
61
查看次数

从数据框列python中删除非日期值

我有一个头部看起来像的数据框(df):

        Date
0 01/04/2015
1 01/09/1996
2        N/A
3 12/05/1992
4  NOT KNOWN
Run Code Online (Sandbox Code Playgroud)

有没有办法删除非日期值(不是行)?在此示例中,生成的帧将如下所示:

        Date
0 01/04/2015
1 01/09/1996
2        
3 12/05/1992
4  
Run Code Online (Sandbox Code Playgroud)

我能看到的所有示例都希望我删除行,而我想保留它们。

python pandas

2
推荐指数
1
解决办法
755
查看次数

Python Pandas Dataframe - 如果索引日期早于某个日期,则从数据框中删除数据

我有一个按日期索引的数据框(df)

date             BBG.XSWX.KABN.S  BBG.XETR.TKA.S                        
2014-02-03       328.657522          19.083
2014-02-04       327.776510          18.809
2014-02-05       325.657202          18.337
2014-02-06       330.845170          18.690
2014-02-07       334.789668          19.153
Run Code Online (Sandbox Code Playgroud)

有没有办法删除索引日期早于 2014-02-06 的任何行,这样我就会得到结果数据框:

date             BBG.XSWX.KABN.S  BBG.XETR.TKA.S                       
2014-02-06       330.845170          18.690
2014-02-07       334.789668          19.153
Run Code Online (Sandbox Code Playgroud)

python pandas

1
推荐指数
1
解决办法
2991
查看次数

VBA - 在文件名中使用通配符来避免处理文件

我在 VBA 中循环遍历多个目录,并试图避免在每个目录中处理一个文件。文件名的前两个字母根据我搜索的目录而变化。

例如,在一个目录中,该文件将被称为 EE-Help-Me.xlsx,而在另一个目录中,它将被称为 F-Help-Me.xlsx。我曾尝试使用通配符 *-Help-Me,但在处理文件时显然做错了。我怎样才能解决这个问题?

我的代码是:

Sub ListFiles(fld As Object, Mask As String)
Dim fl As Object 'File
For Each fl In fld.Files
    If fl.Name Like Mask Then
    'open and interrogate file here

       If fl.Name <> "*-Help-Me.xlsx" Then '<<-- not catching when the offending file is present
            Debug.Print fld.Path & "\" & fl.Name
            'Do something
       End If


    End If
Next
End Sub
Run Code Online (Sandbox Code Playgroud)

excel vba

1
推荐指数
1
解决办法
89
查看次数

将数据框列转换为浮点型

我有一个数据帧,historic_price其中有两个列'price''item'并且我试图将多个结果一起存储在另一个名为的数据帧中dayData,但出现异常:

TypeError: can't multiply sequence by non-int of type 'float'
Run Code Online (Sandbox Code Playgroud)

'price'列如下所示:

           price
0        5.86500
1        2.03000
2       13.55000
3      639.75450
4      343.94325
5     1009.43500
6      585.60600
7     2208.72400
8      807.54800
9      236.51530
10      14.34000
Run Code Online (Sandbox Code Playgroud)

'item'列如下所示:

     item
0     0.0
1     0.0
2     0.0
3     0.0
4     0.0
5     0.0
6     0.0
7     0.0
8     0.0
9     0.0
10    0.0
Run Code Online (Sandbox Code Playgroud)

(我知道所有值都是零,但是即使我按项目乘以价格,我仍然应该得到结果(0))

两列的数据类型都是 <class 'pandas.core.series.Series'>

我正在尝试将商品和价格的乘积添加到dayData数据框中,如下所示:

dayData["cash"]  =  historicPrice["price"] …
Run Code Online (Sandbox Code Playgroud)

python pandas

1
推荐指数
1
解决办法
1万
查看次数

cpython-35m-x86_64-linux-gnu.so 是从哪个基本文件类型生成的

我正在尝试找到解决一些继承代码的方法。我找到了一个名为:的编译文件

filename.cpython-35m-x86_64-linux-gnu.so
Run Code Online (Sandbox Code Playgroud)

该文件是从什么文件类型(.py.cpp.pdx)编译而来的?是否还有关于 的每个部分的含义的文档cpython-35m-x86_64-linux-gnu.so

python

1
推荐指数
1
解决办法
2524
查看次数

将一个数据帧列除以另一列 - 除以零

我有一个数据框(dayData),有两列'first''average'. 我希望将“第一”除以“平均”来创建一个新列'second'

使用以下内容:

dayData["second"] = dayData["first"] / dayData["average"]
Run Code Online (Sandbox Code Playgroud)

然而,列中的“平均值”的值为 0 的可能性(因此,当我将两列相除时,我会得到“NaN”值)。我想用零替换“NaN”值。有没有快速的方法来做到这一点?

谢谢

python pandas

0
推荐指数
1
解决办法
2万
查看次数

删除空格

我正在尝试使用以下代码删除我创建的文件名中的空格:

epoch <- strsplit(toString(files[val]),split='.', fixed=TRUE)[[1]][1]
    print(paste(epoch,".csv"))
Run Code Online (Sandbox Code Playgroud)

目前的输出给了我:"2016_Q3 .csv".我想删除和之间的空格3,.所以最后的字符串看起来像"2016_Q3.csv"

我已经看过gsubtrimws,但不能让他们的工作.

r

0
推荐指数
1
解决办法
1914
查看次数

如何将一个添加到列表元素?

我有一个list名为 mylist的空文件,它看起来像

[None,None,None,None,None,None,None]
Run Code Online (Sandbox Code Playgroud)

我有一个 for 循环,每次它过去时都会向每个元素添加一个。

我正在尝试使用以下方法将 1 添加到元素:

mylist[i] = mylist[i]+1 
Run Code Online (Sandbox Code Playgroud)

但我收到错误:

TypeError: unsupported operand type(s) for +: 'NoneType' and 'int'
Run Code Online (Sandbox Code Playgroud)

列表迭代更改的次数,因此不能只向所有元素添加一个。

我正在使用的代码是:

for j in range(0,bucketSize):
    for i in range (0,minibuckets):
        list[i] = list[i]+1
Run Code Online (Sandbox Code Playgroud)

python

0
推荐指数
1
解决办法
69
查看次数

从数组元素返回一个双精度值到控制台

我有一些代码norms声明为大小为 3 x 2 的双数组。我想输出norms[0]到控制台。

#include <iostream> 
using namespace std;
    
double norms[3][2];
_cal_norm(dept,size,max_posn,norms[0]);
cout << norms[0];
Run Code Online (Sandbox Code Playgroud)

我想返回双倍值。我试过用cout << norms[0]它来退货。但它返回以下内容:

规范[0] 1 0x7fff33d52180

有没有办法让我看到双重价值?

c++ arrays

0
推荐指数
1
解决办法
64
查看次数

标签 统计

python ×8

pandas ×5

arrays ×1

c++ ×1

dataframe ×1

excel ×1

indexing ×1

r ×1

regex ×1

reindex ×1

vba ×1