diff options
Diffstat (limited to 'old/inverse_fast.c')
| -rw-r--r-- | old/inverse_fast.c | 51 |
1 files changed, 0 insertions, 51 deletions
diff --git a/old/inverse_fast.c b/old/inverse_fast.c deleted file mode 100644 index 13ace58..0000000 --- a/old/inverse_fast.c +++ /dev/null | |||
| @@ -1,51 +0,0 @@ | |||
| 1 | _static_inline cube_fast_t | ||
| 2 | cleanaftershuffle(cube_fast_t c) | ||
| 3 | { | ||
| 4 | __m256i b; | ||
| 5 | |||
| 6 | b = _mm256_set_epi8( | ||
| 7 | ~0, ~0, ~0, ~0, 0, 0, 0, 0, 0, 0, 0, 0, 0, 0, 0, 0, | ||
| 8 | ~0, ~0, ~0, ~0, ~0, ~0, ~0, ~0, 0, 0, 0, 0, 0, 0, 0, 0 | ||
| 9 | ); | ||
| 10 | |||
| 11 | return _mm256_andnot_si256(b, c); | ||
| 12 | } | ||
| 13 | |||
| 14 | _static_inline cube_fast_t | ||
| 15 | inverse_fast(cube_fast_t c) | ||
| 16 | { | ||
| 17 | /* Method taken from Andrew Skalski's vcube[1]. The addition sequence | ||
| 18 | * was generated using [2]. | ||
| 19 | * [1] https://github.com/Voltara/vcube | ||
| 20 | * [2] http://wwwhomes.uni-bielefeld.de/achim/addition_chain.html | ||
| 21 | */ | ||
| 22 | cube_fast_t v3, vi, vo, vp, ret; | ||
| 23 | |||
| 24 | v3 = _mm256_shuffle_epi8(c, c); | ||
| 25 | v3 = _mm256_shuffle_epi8(v3, c); | ||
| 26 | vi = _mm256_shuffle_epi8(v3, v3); | ||
| 27 | vi = _mm256_shuffle_epi8(vi, vi); | ||
| 28 | vi = _mm256_shuffle_epi8(vi, vi); | ||
| 29 | vi = _mm256_shuffle_epi8(vi, v3); | ||
| 30 | vi = _mm256_shuffle_epi8(vi, vi); | ||
| 31 | vi = _mm256_shuffle_epi8(vi, vi); | ||
| 32 | vi = _mm256_shuffle_epi8(vi, vi); | ||
| 33 | vi = _mm256_shuffle_epi8(vi, vi); | ||
| 34 | vi = _mm256_shuffle_epi8(vi, c); | ||
| 35 | vi = _mm256_shuffle_epi8(vi, vi); | ||
| 36 | vi = _mm256_shuffle_epi8(vi, vi); | ||
| 37 | vi = _mm256_shuffle_epi8(vi, vi); | ||
| 38 | vi = _mm256_shuffle_epi8(vi, vi); | ||
| 39 | vi = _mm256_shuffle_epi8(vi, vi); | ||
| 40 | vi = _mm256_shuffle_epi8(vi, v3); | ||
| 41 | vi = _mm256_shuffle_epi8(vi, vi); | ||
| 42 | vi = _mm256_shuffle_epi8(vi, c); | ||
| 43 | |||
| 44 | vo = _mm256_and_si256(c, _mm256_or_si256(_eo_avx2, _co2_avx2)); | ||
| 45 | vo = _mm256_shuffle_epi8(vo, vi); | ||
| 46 | vp = _mm256_andnot_si256(_mm256_or_si256(_eo_avx2, _co2_avx2), vi); | ||
| 47 | ret = _mm256_or_si256(vp, vo); | ||
| 48 | ret = cleanaftershuffle(ret); | ||
| 49 | |||
| 50 | return invertco_fast(ret); | ||
| 51 | } | ||
