diff --git a/math/fast/fast_matrix_sse.c b/math/fast/fast_matrix_sse.c index 166f71abce..9de79ce760 100644 --- a/math/fast/fast_matrix_sse.c +++ b/math/fast/fast_matrix_sse.c @@ -8,12 +8,12 @@ void fast_matrix_mul_4x4_sse(float *dest, const float *a, const float *b) { int i; - for (i = 0; i < 16; i += 4) { - __m128 a_col_1 = _mm_loadu_ps(a); - __m128 a_col_2 = _mm_loadu_ps(&a[4]); - __m128 a_col_3 = _mm_loadu_ps(&a[8]); - __m128 a_col_4 = _mm_loadu_ps(&a[12]); + __m128 a_col_1 = _mm_loadu_ps(a); + __m128 a_col_2 = _mm_loadu_ps(&a[4]); + __m128 a_col_3 = _mm_loadu_ps(&a[8]); + __m128 a_col_4 = _mm_loadu_ps(&a[12]); + for (i = 0; i < 16; i += 4) { __m128 r_col = _mm_mul_ps(a_col_1, _mm_set1_ps(b[i])); r_col = _mm_add_ps(r_col, _mm_mul_ps(a_col_2, _mm_set1_ps(b[i + 1]))); r_col = _mm_add_ps(r_col, _mm_mul_ps(a_col_3, _mm_set1_ps(b[i + 2]))); diff --git a/native.vcxproj b/native.vcxproj index 59eaa83023..da563a52cd 100644 --- a/native.vcxproj +++ b/native.vcxproj @@ -754,7 +754,9 @@ - + + AssemblyAndSourceCode +