如何在 Python 中检查 .h5 文件

got*_*ota 3 python matlab python-3.x h5py

如何查看给定的 .h5 文件在 Python 中有哪些变量、数据集等?

我可以通过运行这个来读取文件

import h5py
f = h5py.File(filename, 'r')
Run Code Online (Sandbox Code Playgroud)

我现在如何查看我的 .h5 文件有哪些变量?

运行f.keys()输出非信息性

KeysView(<HDF5 file filename (mode r)>)
Run Code Online (Sandbox Code Playgroud)

在 Matlab 中,我只是调用 h5disp(filename) 但想知道如何在 Python 中执行此操作

小智 6

你试过了吗?

print(list(f.keys()))
Run Code Online (Sandbox Code Playgroud)

这应该为您提供 hdf5 文件中的所有组。如果 f 是一个组,您可以对数据集执行相同的操作。


Ima*_*ngo 6

也许矫枉过正,但我​​有这个,可能对某人有用:

from __future__ import print_function

def scan_hdf5(path, recursive=True, tab_step=2):
    def scan_node(g, tabs=0):
        print(' ' * tabs, g.name)
        for k, v in g.items():
            if isinstance(v, h5.Dataset):
                print(' ' * tabs + ' ' * tab_step + ' -', v.name)
            elif isinstance(v, h5.Group) and recursive:
                scan_node(v, tabs=tabs + tab_step)
    with h5.File(path, 'r') as f:
        scan_node(f)
Run Code Online (Sandbox Code Playgroud)

和简单的输入:

>>> scan_hdf5('/tmp/dummy.h5')
/
   - /d1
   /g1
     - /g1/d2
     - /g1/d3
   /g2
     - /g2/d4
     /g2/g3
       - /g2/g3/d5
Run Code Online (Sandbox Code Playgroud)

或者以更有用的方式返回元素的替代版本:

def scan_hdf52(path, recursive=True, tab_step=2):
    def scan_node(g, tabs=0):
        elems = []
        for k, v in g.items():
            if isinstance(v, h5.Dataset):
                elems.append(v.name)
            elif isinstance(v, h5.Group) and recursive:
                elems.append((v.name, scan_node(v, tabs=tabs + tab_step)))
        return elems
    with h5.File(path, 'r') as f:
        return scan_node(f)
Run Code Online (Sandbox Code Playgroud)

有回报:

>>> scan_hdf5_2('/tmp/dummy.h5')
[u'/d1',
 (u'/g1', [u'/g1/d2', u'/g1/d3']),
 (u'/g2', [u'/g2/d4', (u'/g2/g3', [u'/g2/g3/d5'])])]
Run Code Online (Sandbox Code Playgroud)