У меня очень простой вопрос относительно оптимизации, выполняемой компилятором (в моем случае gcc) с использованием флага -O. Я хотел бы сосредоточиться здесь только на векторизации циклов. Предположим, что это простой цикл for без опасности совмещения указателей или условий гонки. Можно ли переписать этот цикл таким образом, чтобы код, сгенерированный компилятором с флагом -O0, был таким же быстрым, как если бы цикл был векторизован компилятором?
Подробнее здесь: https://stackoverflow.com/questions/197 ... y-compiler