我有一个关于如何在pd.read_hdf函数中过滤结果的问题.所以这里是设置,我有一个pandas数据帧(带有np.datetime64索引),我把它放入hdf5文件.这里没有任何花哨的东西,所以没有使用层次结构或任何东西(也许我可以合并它?).这是一个例子:
Foo Bar
TIME
2014-07-14 12:02:00 0 0
2014-07-14 12:03:00 0 0
2014-07-14 12:04:00 0 0
2014-07-14 12:05:00 0 0
2014-07-14 12:06:00 0 0
2014-07-15 12:02:00 0 0
2014-07-15 12:03:00 0 0
2014-07-15 12:04:00 0 0
2014-07-15 12:05:00 0 0
2014-07-15 12:06:00 0 0
2014-07-16 12:02:00 0 0
2014-07-16 12:03:00 0 0
2014-07-16 12:04:00 0 0
2014-07-16 12:05:00 0 0
2014-07-16 12:06:00 0 0
Run Code Online (Sandbox Code Playgroud)
现在我使用以下命令将其存储到.h5中:
store = pd.HDFStore('qux.h5')
#generate df
store.append('data', df)
store.close()
Run Code Online (Sandbox Code Playgroud)
接下来,我将有另一个访问此数据的进程,我想获取此数据的日期/时间片.因此,假设我想要在2014-07-14和2014-07-15之间的日期,并且仅在12:02:00和12:04:00之间的时间.目前我使用以下命令来检索此:
pd.read_hdf('qux.h5', 'data', where='index >= 20140714 and …Run Code Online (Sandbox Code Playgroud)