在 g++ 4.9.2 和 5.3.1 上,此代码需要几秒钟才能编译并生成 52,776 字节的可执行文件:
#include <array>
#include <iostream>
int main()
{
constexpr std::size_t size = 4096;
struct S
{
float f;
S() : f(0.0f) {}
};
std::array<S, size> a = {}; // <-- note aggregate initialization
for (auto& e : a)
std::cerr << e.f;
return 0;
}
增加size
似乎会线性增加编译时间和可执行文件大小。我无法使用 clang 3.5 或 Visual C++ 2015 重现此行为。使用-Os
没有区别。
$ time g++ -O2 -std=c++11 test.cpp
real 0m4.178s
user 0m4.060s
sys 0m0.068s
检查汇编代码显示初始化a
已展开,生成4096 movl
条指令:
main:
.LFB1313:
.cfi_startproc
pushq %rbx
.cfi_def_cfa_offset 16
.cfi_offset 3, -16
subq $16384, %rsp
.cfi_def_cfa_offset 16400
movl $0x00000000, (%rsp)
movl $0x00000000, 4(%rsp)
movq %rsp, %rbx
movl $0x00000000, 8(%rsp)
movl $0x00000000, 12(%rsp)
movl $0x00000000, 16(%rsp)
[...skipping 4000 lines...]
movl $0x00000000, 16376(%rsp)
movl $0x00000000, 16380(%rsp)
这只发生在T
具有非平凡构造函数并且数组使用{}
. 如果我执行以下任何操作,g++ 会生成一个简单的循环:
- 删除
S::S()
; - 删除
S::S()
并初始化S::f
课堂; - 移除聚合初始化(
= {}
); - 编译不带
-O2
.
我完全赞成将循环展开作为一种优化,但我认为这不是一个很好的优化。在我将此报告为错误之前,有人可以确认这是否是预期的行为吗?
[编辑:我为此打开了一个新错误,因为其他错误似乎不匹配。它们更多的是关于较长的编译时间,而不是奇怪的代码生成。]