Skip to content

perf(avx512f): vectorize 16x16 float / 8x8 double transpose#1371

Merged
serge-sans-paille merged 1 commit into
xtensor-stack:masterfrom
DiamonDinoia:avx512-transpose
Jul 7, 2026
Merged

perf(avx512f): vectorize 16x16 float / 8x8 double transpose#1371
serge-sans-paille merged 1 commit into
xtensor-stack:masterfrom
DiamonDinoia:avx512-transpose

Without a 32/64-bit avx512f transpose specialization, batch<float>/<d…

62118a9
Select commit
Loading
Failed to load commit list.
Sign in for the full log view
armv8-a, gcc 14
succeeded Jul 6, 2026 in 8m 37s