[gcc r17-3544] RISC-V: Add test cases for vwadd.vx reg overlap
Pan Li via Gcc-cvs <[email protected]>
| Newsgroups | gmane.comp.gcc.cvs |
|---|---|
| Message-ID | <[email protected]> |
https://gcc.gnu.org/g:c7ea1762b85960c0be3d136527753e93bad817ab commit r17-3544-gc7ea1762b85960c0be3d136527753e93bad817ab Author: Pan Li <[email protected]> Date: Thu Aug 20 08:49:15 2026 +0800 RISC-V: Add test cases for vwadd.vx reg overlap Add test cases for register group overlap, please note it is not overlap as much as possible. gcc/testsuite/ChangeLog: * gcc.target/riscv/rvv/autovec/group_overlap/group_overlap.h: Add test helper macros. * gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i16-m1.c: New test. * gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i16-m2.c: New test. * gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i16-m4.c: New test. * gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i16-mf2.c: New test. * gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i16-mf4.c: New test. * gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i32-m1.c: New test. * gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i32-m2.c: New test. * gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i32-m4.c: New test. * gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i32-mf2.c: New test. * gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i8-m1.c: New test. * gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i8-m2.c: New test. * gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i8-m4.c: New test. * gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i8-mf2.c: New test. * gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i8-mf4.c: New test. * gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i8-mf8.c: New test. Signed-off-by: Pan Li <[email protected]> Diff: --- .../rvv/autovec/group_overlap/group_overlap.h | 127 +++++++++++++++++++++ .../rvv/autovec/group_overlap/vwadd_vx-i16-m1.c | 18 +++ .../rvv/autovec/group_overlap/vwadd_vx-i16-m2.c | 18 +++ .../rvv/autovec/group_overlap/vwadd_vx-i16-m4.c | 18 +++ .../rvv/autovec/group_overlap/vwadd_vx-i16-mf2.c | 19 +++ .../rvv/autovec/group_overlap/vwadd_vx-i16-mf4.c | 19 +++ .../rvv/autovec/group_overlap/vwadd_vx-i32-m1.c | 18 +++ .../rvv/autovec/group_overlap/vwadd_vx-i32-m2.c | 18 +++ .../rvv/autovec/group_overlap/vwadd_vx-i32-m4.c | 18 +++ .../rvv/autovec/group_overlap/vwadd_vx-i32-mf2.c | 19 +++ .../rvv/autovec/group_overlap/vwadd_vx-i8-m1.c | 18 +++ .../rvv/autovec/group_overlap/vwadd_vx-i8-m2.c | 18 +++ .../rvv/autovec/group_overlap/vwadd_vx-i8-m4.c | 18 +++ .../rvv/autovec/group_overlap/vwadd_vx-i8-mf2.c | 19 +++ .../rvv/autovec/group_overlap/vwadd_vx-i8-mf4.c | 19 +++ .../rvv/autovec/group_overlap/vwadd_vx-i8-mf8.c | 19 +++ 16 files changed, 403 insertions(+) diff --git a/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/group_overlap.h b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/group_overlap.h index 19d546d930de..cfccb0fff91f 100644 --- a/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/group_overlap.h +++ b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/group_overlap.h @@ -391,6 +391,117 @@ ST_F ((void *)out, vd14, VL); OUT += VL; \ ST_F ((void *)out, vd15, VL); OUT += VL; \ +#define LOOP_DUAL_WIDEN_BINARY_VX_BODY_X4(NT, WT, LD_NF, OUT_F, ST_F, OUT, \ + START, X, VL) \ + NT vs0 = LD_NF ((void *)START, VL); START += VL; \ + NT vs1 = LD_NF ((void *)START, VL); START += VL; \ + NT vs2 = LD_NF ((void *)START, VL); START += VL; \ + NT vs3 = LD_NF ((void *)START, VL); START += VL; \ + \ + asm volatile("nop" ::: "memory"); \ + \ + WT vd0 = OUT_F (vs0, X, VL); \ + WT vd1 = OUT_F (vs1, X, VL); \ + WT vd2 = OUT_F (vs2, X, VL); \ + WT vd3 = OUT_F (vs3, X, VL); \ + \ + asm volatile("nop" ::: "memory"); \ + \ + ST_F ((void *)out, vd0, VL); OUT += VL; \ + ST_F ((void *)out, vd1, VL); OUT += VL; \ + ST_F ((void *)out, vd2, VL); OUT += VL; \ + ST_F ((void *)out, vd3, VL); OUT += VL; \ + +#define LOOP_DUAL_WIDEN_BINARY_VX_BODY_X8(NT, WT, LD_NF, OUT_F, ST_F, OUT, \ + START, X, VL) \ + NT vs0 = LD_NF ((void *)START, VL); START += VL; \ + NT vs1 = LD_NF ((void *)START, VL); START += VL; \ + NT vs2 = LD_NF ((void *)START, VL); START += VL; \ + NT vs3 = LD_NF ((void *)START, VL); START += VL; \ + NT vs4 = LD_NF ((void *)START, VL); START += VL; \ + NT vs5 = LD_NF ((void *)START, VL); START += VL; \ + NT vs6 = LD_NF ((void *)START, VL); START += VL; \ + NT vs7 = LD_NF ((void *)START, VL); START += VL; \ + \ + asm volatile("nop" ::: "memory"); \ + \ + WT vd0 = OUT_F (vs0, X, VL); \ + WT vd1 = OUT_F (vs1, X, VL); \ + WT vd2 = OUT_F (vs2, X, VL); \ + WT vd3 = OUT_F (vs3, X, VL); \ + WT vd4 = OUT_F (vs4, X, VL); \ + WT vd5 = OUT_F (vs5, X, VL); \ + WT vd6 = OUT_F (vs6, X, VL); \ + WT vd7 = OUT_F (vs7, X, VL); \ + \ + asm volatile("nop" ::: "memory"); \ + \ + ST_F ((void *)out, vd0, VL); OUT += VL; \ + ST_F ((void *)out, vd1, VL); OUT += VL; \ + ST_F ((void *)out, vd2, VL); OUT += VL; \ + ST_F ((void *)out, vd3, VL); OUT += VL; \ + ST_F ((void *)out, vd4, VL); OUT += VL; \ + ST_F ((void *)out, vd5, VL); OUT += VL; \ + ST_F ((void *)out, vd6, VL); OUT += VL; \ + ST_F ((void *)out, vd7, VL); OUT += VL; \ + +#define LOOP_DUAL_WIDEN_BINARY_VX_BODY_X16(NT, WT, LD_NF, OUT_F, ST_F, OUT, \ + START, X, VL) \ + NT vs0 = LD_NF ((void *)START, VL); START += VL; \ + NT vs1 = LD_NF ((void *)START, VL); START += VL; \ + NT vs2 = LD_NF ((void *)START, VL); START += VL; \ + NT vs3 = LD_NF ((void *)START, VL); START += VL; \ + NT vs4 = LD_NF ((void *)START, VL); START += VL; \ + NT vs5 = LD_NF ((void *)START, VL); START += VL; \ + NT vs6 = LD_NF ((void *)START, VL); START += VL; \ + NT vs7 = LD_NF ((void *)START, VL); START += VL; \ + NT vs8 = LD_NF ((void *)START, VL); START += VL; \ + NT vs9 = LD_NF ((void *)START, VL); START += VL; \ + NT vs10 = LD_NF ((void *)START, VL); START += VL; \ + NT vs11 = LD_NF ((void *)START, VL); START += VL; \ + NT vs12 = LD_NF ((void *)START, VL); START += VL; \ + NT vs13 = LD_NF ((void *)START, VL); START += VL; \ + NT vs14 = LD_NF ((void *)START, VL); START += VL; \ + NT vs15 = LD_NF ((void *)START, VL); START += VL; \ + \ + asm volatile("nop" ::: "memory"); \ + \ + WT vd0 = OUT_F (vs0, X, VL); \ + WT vd1 = OUT_F (vs1, X, VL); \ + WT vd2 = OUT_F (vs2, X, VL); \ + WT vd3 = OUT_F (vs3, X, VL); \ + WT vd4 = OUT_F (vs4, X, VL); \ + WT vd5 = OUT_F (vs5, X, VL); \ + WT vd6 = OUT_F (vs6, X, VL); \ + WT vd7 = OUT_F (vs7, X, VL); \ + WT vd8 = OUT_F (vs8, X, VL); \ + WT vd9 = OUT_F (vs9, X, VL); \ + WT vd10 = OUT_F (vs10, X, VL); \ + WT vd11 = OUT_F (vs11, X, VL); \ + WT vd12 = OUT_F (vs12, X, VL); \ + WT vd13 = OUT_F (vs13, X, VL); \ + WT vd14 = OUT_F (vs14, X, VL); \ + WT vd15 = OUT_F (vs15, X, VL); \ + \ + asm volatile("nop" ::: "memory"); \ + \ + ST_F ((void *)out, vd0, VL); OUT += VL; \ + ST_F ((void *)out, vd1, VL); OUT += VL; \ + ST_F ((void *)out, vd2, VL); OUT += VL; \ + ST_F ((void *)out, vd3, VL); OUT += VL; \ + ST_F ((void *)out, vd4, VL); OUT += VL; \ + ST_F ((void *)out, vd5, VL); OUT += VL; \ + ST_F ((void *)out, vd6, VL); OUT += VL; \ + ST_F ((void *)out, vd7, VL); OUT += VL; \ + ST_F ((void *)out, vd8, VL); OUT += VL; \ + ST_F ((void *)out, vd9, VL); OUT += VL; \ + ST_F ((void *)out, vd10, VL); OUT += VL; \ + ST_F ((void *)out, vd11, VL); OUT += VL; \ + ST_F ((void *)out, vd12, VL); OUT += VL; \ + ST_F ((void *)out, vd13, VL); OUT += VL; \ + ST_F ((void *)out, vd14, VL); OUT += VL; \ + ST_F ((void *)out, vd15, VL); OUT += VL; \ + #define LOOP_DUAL_WIDEN_BINARY_BODY_SU_X4(NT, NUT, WT, LD_NF, \ LD_NUF, OUT_F, ST_F, OUT, \ START, VL) \ @@ -996,6 +1107,22 @@ } \ } +#define DEF_GROUP_OVERLAP_BINARY_3(VL_F, NT, WT, ST, LD_NF, OUT_F, ST_F, \ + NAME, LOOP_BODY) \ + void test_group_overlap_##NAME##_##NT##_binary_3(uint8_t *data, \ + uint8_t *out, \ + ST x, \ + size_t limit) \ + { \ + uint8_t *start = data; \ + uint8_t *end = data + limit; \ + size_t vl = VL_F (); \ + \ + while (start < end) { \ + LOOP_BODY (NT, WT, LD_NF, OUT_F, ST_F, out, start, x, vl); \ + } \ + } + #define DEF_GROUP_OVERLAP_TERNARY_0(VL_F, NT, WT, LD_NF, LD_WF, OUT_F, \ ST_F, NAME, LOOP_BODY) \ void test_group_overlap_##NAME##_##NT##_ternary_0(uint8_t *data, \ diff --git a/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i16-m1.c b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i16-m1.c new file mode 100644 index 000000000000..a64c50f59041 --- /dev/null +++ b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i16-m1.c @@ -0,0 +1,18 @@ +/* { dg-do compile } */ +/* { dg-options "-march=rv64gcv -mabi=lp64d" } */ + +#include "group_overlap.h" + +DEF_GROUP_OVERLAP_BINARY_3( + __riscv_vsetvlmax_e16m1, + vint16m1_t, + vint32m2_t, + int16_t, + __riscv_vle16_v_i16m1, + __riscv_vwadd_vx_i32m2, + __riscv_vse32_v_i32m2, + vwadd_vx, + LOOP_DUAL_WIDEN_BINARY_VX_BODY_X16) + +/* { dg-final { scan-assembler-times {vwadd\.vx\s+v0,v1,} 1 } } */ +/* { dg-final { scan-assembler-times {vwadd\.vx\s+v2,v3,} 1 } } */ diff --git a/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i16-m2.c b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i16-m2.c new file mode 100644 index 000000000000..e06589b42678 --- /dev/null +++ b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i16-m2.c @@ -0,0 +1,18 @@ +/* { dg-do compile } */ +/* { dg-options "-march=rv64gcv -mabi=lp64d" } */ + +#include "group_overlap.h" + +DEF_GROUP_OVERLAP_BINARY_3( + __riscv_vsetvlmax_e16m2, + vint16m2_t, + vint32m4_t, + int16_t, + __riscv_vle16_v_i16m2, + __riscv_vwadd_vx_i32m4, + __riscv_vse32_v_i32m4, + vwadd_vx, + LOOP_DUAL_WIDEN_BINARY_VX_BODY_X8) + +/* { dg-final { scan-assembler-times {vwadd\.vx\s+v0,v2,} 1 } } */ +/* { dg-final { scan-assembler-times {vwadd\.vx\s+v4,v6,} 1 } } */ diff --git a/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i16-m4.c b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i16-m4.c new file mode 100644 index 000000000000..277a3c29bd36 --- /dev/null +++ b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i16-m4.c @@ -0,0 +1,18 @@ +/* { dg-do compile } */ +/* { dg-options "-march=rv64gcv -mabi=lp64d" } */ + +#include "group_overlap.h" + +DEF_GROUP_OVERLAP_BINARY_3( + __riscv_vsetvlmax_e16m4, + vint16m4_t, + vint32m8_t, + int16_t, + __riscv_vle16_v_i16m4, + __riscv_vwadd_vx_i32m8, + __riscv_vse32_v_i32m8, + vwadd_vx, + LOOP_DUAL_WIDEN_BINARY_VX_BODY_X4) + +/* { dg-final { scan-assembler-times {vwadd\.vx\s+v0,v4,} 1 } } */ +/* { dg-final { scan-assembler-times {vwadd\.vx\s+v8,v12,} 1 } } */ diff --git a/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i16-mf2.c b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i16-mf2.c new file mode 100644 index 000000000000..215fec967195 --- /dev/null +++ b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i16-mf2.c @@ -0,0 +1,19 @@ +/* { dg-do compile } */ +/* { dg-options "-march=rv64gcv -mabi=lp64d" } */ + +#include "group_overlap.h" + +DEF_GROUP_OVERLAP_BINARY_3( + __riscv_vsetvlmax_e16m1, + vint16mf2_t, + vint32m1_t, + int16_t, + __riscv_vle16_v_i16mf2, + __riscv_vwadd_vx_i32m1, + __riscv_vse32_v_i32m1, + vwadd_vx, + LOOP_DUAL_WIDEN_BINARY_VX_BODY_X16) + +/* The fractional LMUL source has EMUL < 1, thus the widened destination + register group must not overlap the source at all. */ +/* { dg-final { scan-assembler-not {vwadd\.vx\s+(v[0-9]+),\1,} } } */ diff --git a/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i16-mf4.c b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i16-mf4.c new file mode 100644 index 000000000000..16a59070e18a --- /dev/null +++ b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i16-mf4.c @@ -0,0 +1,19 @@ +/* { dg-do compile } */ +/* { dg-options "-march=rv64gcv -mabi=lp64d" } */ + +#include "group_overlap.h" + +DEF_GROUP_OVERLAP_BINARY_3( + __riscv_vsetvlmax_e16m1, + vint16mf4_t, + vint32mf2_t, + int16_t, + __riscv_vle16_v_i16mf4, + __riscv_vwadd_vx_i32mf2, + __riscv_vse32_v_i32mf2, + vwadd_vx, + LOOP_DUAL_WIDEN_BINARY_VX_BODY_X16) + +/* The fractional LMUL source has EMUL < 1, thus the widened destination + register group must not overlap the source at all. */ +/* { dg-final { scan-assembler-not {vwadd\.vx\s+(v[0-9]+),\1,} } } */ diff --git a/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i32-m1.c b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i32-m1.c new file mode 100644 index 000000000000..b4dc40a2e614 --- /dev/null +++ b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i32-m1.c @@ -0,0 +1,18 @@ +/* { dg-do compile } */ +/* { dg-options "-march=rv64gcv -mabi=lp64d" } */ + +#include "group_overlap.h" + +DEF_GROUP_OVERLAP_BINARY_3( + __riscv_vsetvlmax_e32m1, + vint32m1_t, + vint64m2_t, + int32_t, + __riscv_vle32_v_i32m1, + __riscv_vwadd_vx_i64m2, + __riscv_vse64_v_i64m2, + vwadd_vx, + LOOP_DUAL_WIDEN_BINARY_VX_BODY_X16) + +/* { dg-final { scan-assembler-times {vwadd\.vx\s+v0,v1,} 1 } } */ +/* { dg-final { scan-assembler-times {vwadd\.vx\s+v2,v3,} 1 } } */ diff --git a/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i32-m2.c b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i32-m2.c new file mode 100644 index 000000000000..632104a93201 --- /dev/null +++ b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i32-m2.c @@ -0,0 +1,18 @@ +/* { dg-do compile } */ +/* { dg-options "-march=rv64gcv -mabi=lp64d" } */ + +#include "group_overlap.h" + +DEF_GROUP_OVERLAP_BINARY_3( + __riscv_vsetvlmax_e32m2, + vint32m2_t, + vint64m4_t, + int32_t, + __riscv_vle32_v_i32m2, + __riscv_vwadd_vx_i64m4, + __riscv_vse64_v_i64m4, + vwadd_vx, + LOOP_DUAL_WIDEN_BINARY_VX_BODY_X8) + +/* { dg-final { scan-assembler-times {vwadd\.vx\s+v0,v2,} 1 } } */ +/* { dg-final { scan-assembler-times {vwadd\.vx\s+v4,v6,} 1 } } */ diff --git a/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i32-m4.c b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i32-m4.c new file mode 100644 index 000000000000..fc72f0a95774 --- /dev/null +++ b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i32-m4.c @@ -0,0 +1,18 @@ +/* { dg-do compile } */ +/* { dg-options "-march=rv64gcv -mabi=lp64d" } */ + +#include "group_overlap.h" + +DEF_GROUP_OVERLAP_BINARY_3( + __riscv_vsetvlmax_e32m4, + vint32m4_t, + vint64m8_t, + int32_t, + __riscv_vle32_v_i32m4, + __riscv_vwadd_vx_i64m8, + __riscv_vse64_v_i64m8, + vwadd_vx, + LOOP_DUAL_WIDEN_BINARY_VX_BODY_X4) + +/* { dg-final { scan-assembler-times {vwadd\.vx\s+v0,v4,} 1 } } */ +/* { dg-final { scan-assembler-times {vwadd\.vx\s+v8,v12,} 1 } } */ diff --git a/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i32-mf2.c b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i32-mf2.c new file mode 100644 index 000000000000..3820d27efd39 --- /dev/null +++ b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i32-mf2.c @@ -0,0 +1,19 @@ +/* { dg-do compile } */ +/* { dg-options "-march=rv64gcv -mabi=lp64d" } */ + +#include "group_overlap.h" + +DEF_GROUP_OVERLAP_BINARY_3( + __riscv_vsetvlmax_e32m1, + vint32mf2_t, + vint64m1_t, + int32_t, + __riscv_vle32_v_i32mf2, + __riscv_vwadd_vx_i64m1, + __riscv_vse64_v_i64m1, + vwadd_vx, + LOOP_DUAL_WIDEN_BINARY_VX_BODY_X16) + +/* The fractional LMUL source has EMUL < 1, thus the widened destination + register group must not overlap the source at all. */ +/* { dg-final { scan-assembler-not {vwadd\.vx\s+(v[0-9]+),\1,} } } */ diff --git a/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i8-m1.c b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i8-m1.c new file mode 100644 index 000000000000..a7c6712298e6 --- /dev/null +++ b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i8-m1.c @@ -0,0 +1,18 @@ +/* { dg-do compile } */ +/* { dg-options "-march=rv64gcv -mabi=lp64d" } */ + +#include "group_overlap.h" + +DEF_GROUP_OVERLAP_BINARY_3( + __riscv_vsetvlmax_e8m1, + vint8m1_t, + vint16m2_t, + int8_t, + __riscv_vle8_v_i8m1, + __riscv_vwadd_vx_i16m2, + __riscv_vse16_v_i16m2, + vwadd_vx, + LOOP_DUAL_WIDEN_BINARY_VX_BODY_X16) + +/* { dg-final { scan-assembler-times {vwadd\.vx\s+v0,v1,} 1 } } */ +/* { dg-final { scan-assembler-times {vwadd\.vx\s+v2,v3,} 1 } } */ diff --git a/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i8-m2.c b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i8-m2.c new file mode 100644 index 000000000000..8fb8c8c3a3d5 --- /dev/null +++ b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i8-m2.c @@ -0,0 +1,18 @@ +/* { dg-do compile } */ +/* { dg-options "-march=rv64gcv -mabi=lp64d" } */ + +#include "group_overlap.h" + +DEF_GROUP_OVERLAP_BINARY_3( + __riscv_vsetvlmax_e8m2, + vint8m2_t, + vint16m4_t, + int8_t, + __riscv_vle8_v_i8m2, + __riscv_vwadd_vx_i16m4, + __riscv_vse16_v_i16m4, + vwadd_vx, + LOOP_DUAL_WIDEN_BINARY_VX_BODY_X8) + +/* { dg-final { scan-assembler-times {vwadd\.vx\s+v0,v2,} 1 } } */ +/* { dg-final { scan-assembler-times {vwadd\.vx\s+v4,v6,} 1 } } */ diff --git a/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i8-m4.c b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i8-m4.c new file mode 100644 index 000000000000..e15519a64a5f --- /dev/null +++ b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i8-m4.c @@ -0,0 +1,18 @@ +/* { dg-do compile } */ +/* { dg-options "-march=rv64gcv -mabi=lp64d" } */ + +#include "group_overlap.h" + +DEF_GROUP_OVERLAP_BINARY_3( + __riscv_vsetvlmax_e8m4, + vint8m4_t, + vint16m8_t, + int8_t, + __riscv_vle8_v_i8m4, + __riscv_vwadd_vx_i16m8, + __riscv_vse16_v_i16m8, + vwadd_vx, + LOOP_DUAL_WIDEN_BINARY_VX_BODY_X4) + +/* { dg-final { scan-assembler-times {vwadd\.vx\s+v0,v4,} 1 } } */ +/* { dg-final { scan-assembler-times {vwadd\.vx\s+v8,v12,} 1 } } */ diff --git a/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i8-mf2.c b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i8-mf2.c new file mode 100644 index 000000000000..cc7d1e0ccf2a --- /dev/null +++ b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i8-mf2.c @@ -0,0 +1,19 @@ +/* { dg-do compile } */ +/* { dg-options "-march=rv64gcv -mabi=lp64d" } */ + +#include "group_overlap.h" + +DEF_GROUP_OVERLAP_BINARY_3( + __riscv_vsetvlmax_e8m1, + vint8mf2_t, + vint16m1_t, + int8_t, + __riscv_vle8_v_i8mf2, + __riscv_vwadd_vx_i16m1, + __riscv_vse16_v_i16m1, + vwadd_vx, + LOOP_DUAL_WIDEN_BINARY_VX_BODY_X16) + +/* The fractional LMUL source has EMUL < 1, thus the widened destination + register group must not overlap the source at all. */ +/* { dg-final { scan-assembler-not {vwadd\.vx\s+(v[0-9]+),\1,} } } */ diff --git a/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i8-mf4.c b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i8-mf4.c new file mode 100644 index 000000000000..0826024f991e --- /dev/null +++ b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i8-mf4.c @@ -0,0 +1,19 @@ +/* { dg-do compile } */ +/* { dg-options "-march=rv64gcv -mabi=lp64d" } */ + +#include "group_overlap.h" + +DEF_GROUP_OVERLAP_BINARY_3( + __riscv_vsetvlmax_e8m1, + vint8mf4_t, + vint16mf2_t, + int8_t, + __riscv_vle8_v_i8mf4, + __riscv_vwadd_vx_i16mf2, + __riscv_vse16_v_i16mf2, + vwadd_vx, + LOOP_DUAL_WIDEN_BINARY_VX_BODY_X16) + +/* The fractional LMUL source has EMUL < 1, thus the widened destination + register group must not overlap the source at all. */ +/* { dg-final { scan-assembler-not {vwadd\.vx\s+(v[0-9]+),\1,} } } */ diff --git a/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i8-mf8.c b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i8-mf8.c new file mode 100644 index 000000000000..e88a6b3f300f --- /dev/null +++ b/gcc/testsuite/gcc.target/riscv/rvv/autovec/group_overlap/vwadd_vx-i8-mf8.c @@ -0,0 +1,19 @@ +/* { dg-do compile } */ +/* { dg-options "-march=rv64gcv -mabi=lp64d" } */ + +#include "group_overlap.h" + +DEF_GROUP_OVERLAP_BINARY_3( + __riscv_vsetvlmax_e8m1, + vint8mf8_t, + vint16mf4_t, + int8_t, + __riscv_vle8_v_i8mf8, + __riscv_vwadd_vx_i16mf4, + __riscv_vse16_v_i16mf4, + vwadd_vx, + LOOP_DUAL_WIDEN_BINARY_VX_BODY_X16) + +/* The fractional LMUL source has EMUL < 1, thus the widened destination + register group must not overlap the source at all. */ +/* { dg-final { scan-assembler-not {vwadd\.vx\s+(v[0-9]+),\1,} } } */