为什么 std::basic_istream::ignore() 提取的字符多于指定的字符?

fja*_*don 8 c++ iostream

我有以下代码:

#include <iomanip>
#include <iostream>
#include <sstream>
#include <string>

using namespace std;

int main(int argc, char* argv[]) {
    stringstream buffer("1234567890 ");
    cout << "pos-before: " << buffer.tellg() << endl;
    buffer.ignore(10, ' ');
    cout << "pos-after: " << buffer.tellg() << endl;
    cout << "eof: " << buffer.eof() << endl;
}
Run Code Online (Sandbox Code Playgroud)

它产生这个输出:

pos-before: 0
pos-after: 11
eof: 0
Run Code Online (Sandbox Code Playgroud)

我希望pos-after是10而不是11。根据规范,当设置以下任一条件时, ignore方法应停止:

  1. 提取了计数字符。在计数等于的特殊情况下禁用此测试std::numeric_limits<std::streamsize>::max()
  2. 文件结束条件出现在输入序列中,在这种情况下,函数调用 setstate(eofbit)
  3. 输入序列中的下一个可用字符 c 是 delim,由 确定Traits::eq_int_type(Traits::to_int_type(c), delim)。分隔符被提取并丢弃。如果 delim 是Traits::eof()

在这种情况下,我希望规则 1 在所有其他规则之前触发,并在流位置为 10 时停止。

执行表明情况并非如此。我误解了什么?

我还尝试了代码的变体,其中我只忽略了 9 个字符。在这种情况下,输出是预期的:

pos-before: 0
pos-after: 9
eof: 0
Run Code Online (Sandbox Code Playgroud)

所以看起来在ignore()提取字符数的情况下,它仍然检查下一个字符是否是delimiter,如果是,它也提取它。我可以用g++和复制clang++。

我也尝试过这种代码变体:

#include <iomanip>
#include <iostream>
#include <sstream>
#include <string>

using namespace std;

int main(int argc, char* argv[]) {
    cout << "--- 10x get\n";
    stringstream buffer("1234567890");
    cout << "pos-before: " << buffer.tellg() << '\n';
    for(int i=0; i<10; ++i)
        buffer.get();
    cout << "pos-after: " << buffer.tellg() << '\n';
    cout << "eof: " << buffer.eof() << '\n';
    
    cout << "--- ignore(10)\n";
    stringstream buffer2("1234567890");
    cout << "pos-before: " << buffer2.tellg() << '\n';
    buffer2.ignore(10);
    cout << "pos-after: " << buffer2.tellg() << '\n';
    cout << "eof: " << buffer2.eof() << '\n';
}
Run Code Online (Sandbox Code Playgroud)

结果是:

--- 10x get
pos-before: 0
pos-after: 10
eof: 0
--- ignore(10)
pos-before: 0
pos-after: -1
eof: 1
Run Code Online (Sandbox Code Playgroud)

我们看到 usingignore()会在文件上产生文件结束条件。表示在提取 10ignore()个字符后确实尝试提取一个字符。但在这种情况下,第三个条件被禁用,ignore()不应该试图查看下一个字符是什么。

Die*_*ühl 1

[istream.unformatted] 第 25 段中的规范std::basic_istream::ignore有点不清楚:它指出“字符被提取,直到发生以下任何情况:”没有任何顺序指示。第 25.1 段规定最多n提取字符(除非n)std::numeric_limits<std::streamsize>,第 25.3 段规定字符匹配。然而,即使可以按任何顺序应用条件,这里也不存在冲突:第nth 个字符还不是预期的字符,ignore()应该停止。

正如评论中指出的那样,存在一个错误,libstdc++该错误似乎仍然存在于随gcc-10.2.0. 使用clang++with libc++(如有必要,-stdlib=libc++在调用时使用clang++)不会显示相同的行为。

顺便说一句:未格式化的输入操作正在设置读取的字符数,可以使用gcount(). 在流中查找是比访问此计数更昂贵的操作。usinggcount()也显示了问题(说到昂贵的操作,我还std::endl用 using替换了 use '\n';有关更多详细信息,请参阅此视频或本文):

#include <iomanip>
#include <iostream>
#include <sstream>
#include <string>

int main() {
    std::istringstream buffer("1234567890 ");
    buffer.ignore(10, ' ');
    std::cout << "gcount: " << buffer.gcount() << '\n';
    std::cout << "eof: " << std::boolalpha << buffer.eof() << '\n';
}
Run Code Online (Sandbox Code Playgroud)