]> gcc.gnu.org Git - gcc.git/commitdiff
RISC-V: autovec: Verify that GET_MODE_NUNITS is a multiple of 2.
authorMichael Collison <collison@rivosinc.com>
Sat, 6 May 2023 18:37:50 +0000 (12:37 -0600)
committerJeff Law <jlaw@ventanamicro>
Sat, 6 May 2023 18:37:50 +0000 (12:37 -0600)
While working on autovectorizing for the RISCV port I encountered an issue
where can_duplicate_and_interleave_p assumes that GET_MODE_NUNITS is a
evenly divisible by two. The RISC-V target has vector modes (e.g. VNx1DImode),
where GET_MODE_NUNITS is equal to one.

Tested on RISCV and x86_64-linux-gnu. Okay?

gcc/
* tree-vect-slp.cc (can_duplicate_and_interleave_p):
Check that GET_MODE_NUNITS is a multiple of 2.

gcc/tree-vect-slp.cc

index b299e209b5ba71e2c4b63f07b8fb6d8170494ce8..3b7a21724ec304807ffc09b5586a6101a2a6f697 100644 (file)
@@ -423,10 +423,13 @@ can_duplicate_and_interleave_p (vec_info *vinfo, unsigned int count,
            (GET_MODE_BITSIZE (int_mode), 1);
          tree vector_type
            = get_vectype_for_scalar_type (vinfo, int_type, count);
+         poly_int64 half_nelts;
          if (vector_type
              && VECTOR_MODE_P (TYPE_MODE (vector_type))
              && known_eq (GET_MODE_SIZE (TYPE_MODE (vector_type)),
-                          GET_MODE_SIZE (base_vector_mode)))
+                          GET_MODE_SIZE (base_vector_mode))
+             && multiple_p (GET_MODE_NUNITS (TYPE_MODE (vector_type)),
+                            2, &half_nelts))
            {
              /* Try fusing consecutive sequences of COUNT / NVECTORS elements
                 together into elements of type INT_TYPE and using the result
@@ -434,7 +437,7 @@ can_duplicate_and_interleave_p (vec_info *vinfo, unsigned int count,
              poly_uint64 nelts = GET_MODE_NUNITS (TYPE_MODE (vector_type));
              vec_perm_builder sel1 (nelts, 2, 3);
              vec_perm_builder sel2 (nelts, 2, 3);
-             poly_int64 half_nelts = exact_div (nelts, 2);
+
              for (unsigned int i = 0; i < 3; ++i)
                {
                  sel1.quick_push (i);
This page took 0.07782 seconds and 5 git commands to generate.