我不清楚tf.TFRecordDatasetbuffer_size中的参数的作用。假设我们有以下代码:
dataset = dataset.shuffle(buffer_size=10000).repeat().batch(batch_size)
Run Code Online (Sandbox Code Playgroud)
这是否意味着只会使用前 10k 个样本并永远重复,或者我会遍历整个数据集?如果不是,它到底有什么作用?这段代码又如何呢?
dataset = dataset.repeat().shuffle(buffer_size=10000).batch(batch_size)
Run Code Online (Sandbox Code Playgroud)
我注意到了这篇文章,但它没有提及任何内容buffer_size。