给ifstream定源和ofstream目标,从streampos(offset)源开始复制 N 个字节的最快方法是什么?
编辑
我想到的最简单的方法是使用一个简单的缓冲区:
char *buf = new char[N];
is.seekg(offset);
is.read(buf, N);
os.write(buf, N);
delete buf;
Run Code Online (Sandbox Code Playgroud)
或更小的固定大小的缓冲区:
char buf[BUF_SIZE];
is.seekg(offset);
while (N > 0) {
int n = min(BUF_SIZE, N);
is.read(buf, n);
os.write(buf, n);
N -= n;
}
Run Code Online (Sandbox Code Playgroud)
我想知道还有什么比这更快或更有效的方法。
您可以尝试不同的解决方案。关于效率衡量最重要的事情。
您可以在此处查找示例实现:如何优雅有效地将文件读入向量?
在大多数情况下,缓冲区越大,读/写速度越快。使用迭代器解决方案传递单个字节,例如如下所示:
std::copy(std::istream_iterator<char>(is),
std::istream_iterator<char>(),
std::ostream_iterator<char>(os));
Run Code Online (Sandbox Code Playgroud)
尽管看起来不错,但就效率而言,这几乎是最糟糕的情况 - 至少对于我测试过的设置来说是这样。
从指定的偏移量一次读取整个文件到一个大的缓冲区会给出最佳的时间结果 - 你可以尝试这个,除非你有一些内存限制。为此,您应该计算文件大小,将数据读取到缓冲区(例如像这样初始化:)std::vector<char> buff(fileSize, 0)并在一次调用时将其写入输出流。
由于您只想复制N字节,因此您应该将该值与文件大小减去起始偏移量进行比较,以便仍然能够进行一次大的读/写。
例如:
// helper function
streampos getSizeToEnd(ifstream& is)
{
auto currentPosition = is.tellg();
is.seekg(0, is.end);
auto length = is.tellg() - currentPosition;
is.seekg(currentPosition, is.beg);
return length;
}
int main()
{
std::ifstream is;
std::ofstream os;
...
const auto offset = 100;
is.seekg(offset);
std::vector<char> buff(getSizeToEnd(is), 0);
// read the data chunk to buffer and from buffer to output stream
is.read(buff.data(), buff.size());
os.write(buff.data(), buff.size());
...
}
Run Code Online (Sandbox Code Playgroud)