与java相比,为什么这个C++代码执行速度如此之慢?

Bil*_*l B 8 c++ java performance

我最近用Java编写了一个计算密集型算法,然后将其翻译成C++.令我惊讶的是,C++的执行速度要慢得多.我现在编写了一个更短的Java测试程序,以及相应的C++程序 - 见下文.我的原始代码具有很多数组访问权限,测试代码也是如此.C++的执行时间要长5.5倍(请参阅每个程序末尾的注释).

结论在下面的 1 21条评论之后......

测试代码:

  1. g++ -o ... Java快5.5倍
  2. g++ -O3 -o ... Java快2.9倍
  3. g++ -fprofile-generate -march=native -O3 -o ...(运行,然后g++ -fprofile-use等)Java 1.07倍的速度.

我原来的项目(比测试代码复杂得多):

  1. Java快了1.8倍
  2. C++快了1.9倍
  3. C++快了2倍
Software environment:
    Ubuntu 16.04 (64 bit).
    Netbeans 8.2 / jdk 8u121 (java code executed inside netbeans)
    g++ (Ubuntu 5.4.0-6ubuntu1~16.04.4) 5.4.0 20160609
    Compilation: g++ -o cpp_test cpp_test.cpp
Run Code Online (Sandbox Code Playgroud)

Java代码:

public class JavaTest {
    public static void main(String[] args) {
        final int ARRAY_LENGTH = 100;
        final int FINISH_TRIGGER = 100000000;
        int[] intArray = new int[ARRAY_LENGTH];
        for (int i = 0; i < ARRAY_LENGTH; i++) intArray[i] = 1;
        int i = 0;
        boolean finished = false;
        long loopCount = 0;
        System.out.println("Start");
        long startTime = System.nanoTime();
        while (!finished) {
            loopCount++;
            intArray[i]++;
            if (intArray[i] >= FINISH_TRIGGER) finished = true;
            else if (i <(ARRAY_LENGTH - 1)) i++;
            else i = 0;
        }
        System.out.println("Finish: " + loopCount + " loops; " +
            ((System.nanoTime() - startTime)/1e9) + " secs");
        // 5 executions in range 5.98 - 6.17 secs (each 9999999801 loops)
    }
}
Run Code Online (Sandbox Code Playgroud)

C++代码:

//cpp_test.cpp:
#include <iostream>
#include <sys/time.h>
int main() {
    const int ARRAY_LENGTH = 100;
    const int FINISH_TRIGGER = 100000000;
    int *intArray = new int[ARRAY_LENGTH];
    for (int i = 0; i < ARRAY_LENGTH; i++) intArray[i] = 1;
    int i = 0;
    bool finished = false;
    long long loopCount = 0;
    std::cout << "Start\n";
    timespec ts;
    clock_gettime(CLOCK_REALTIME, &ts);
    long long startTime = (1000000000*ts.tv_sec) + ts.tv_nsec;
    while (!finished) {
        loopCount++;
        intArray[i]++;
        if (intArray[i] >= FINISH_TRIGGER) finished = true;
        else if (i < (ARRAY_LENGTH - 1)) i++;
        else i = 0;
    }
    clock_gettime(CLOCK_REALTIME, &ts);
    double elapsedTime =
        ((1000000000*ts.tv_sec) + ts.tv_nsec - startTime)/1e9;
    std::cout << "Finish: " << loopCount << " loops; ";
    std::cout << elapsedTime << " secs\n";
    // 5 executions in range 33.07 - 33.45 secs (each 9999999801 loops)
}
Run Code Online (Sandbox Code Playgroud)

Dun*_*nes 5

在使用分析信息时,我唯一能让C++程序超越Java的时间.这表明运行时信息中有一些东西(默认情况下是Java),可以更快地执行.

除了一个非平凡的if语句之外,你的程序中没有太多事情发生.也就是说,如果不分析整个程序,很难预测哪个分支最有可能.这让我相信这是一个分支错误预测问题.现代CPU执行指令流水线操作,从而实现更高的CPU吞吐量.但是,这需要预测下一条要执行的指令.如果猜测错误,则必须清除指令管道,并加载正确的指令(这需要时间).

在编译时,编译器没有足够的信息来预测哪个分支最有可能.CPU也做了一些分支预测,但这通常是循环循环和ifs if(而不是其他).

但是,Java具有能够在运行时和编译时使用信息的优点.这允许Java将中间分支识别为最频繁出现的分支,因此为管道预测了此分支.