blob: 31e31ae948bb82fa0ce10c60aa2f96a1524d0f0f [file] [edit]
; NOTE: Assertions have been autogenerated by utils/update_test_checks.py UTC_ARGS: --version 6
; RUN: opt -mtriple=x86_64-- -mcpu=x86-64 -passes=vector-combine -S %s | FileCheck %s --check-prefixes=CHECK,SSE
; RUN: opt -mtriple=x86_64-- -mcpu=x86-64-v2 -passes=vector-combine -S %s | FileCheck %s --check-prefixes=CHECK,SSE
; RUN: opt -mtriple=x86_64-- -mcpu=x86-64-v3 -passes=vector-combine -S %s | FileCheck %s --check-prefixes=CHECK,AVX2
; RUN: opt -mtriple=x86_64-- -mcpu=x86-64-v4 -passes=vector-combine -S %s | FileCheck %s --check-prefixes=CHECK,AVX512
declare i8 @llvm.vector.reduce.or.v16i8(<16 x i8>)
declare i8 @llvm.vector.reduce.umax.v16i8(<16 x i8>)
define i1 @or_nonzero(<16 x i8> %x) {
; SSE-LABEL: define i1 @or_nonzero(
; SSE-SAME: <16 x i8> [[X:%.*]]) #[[ATTR1:[0-9]+]] {
; SSE-NEXT: [[TMP1:%.*]] = icmp ne <16 x i8> [[X]], zeroinitializer
; SSE-NEXT: [[CMP:%.*]] = call i1 @llvm.vector.reduce.or.v16i1(<16 x i1> [[TMP1]])
; SSE-NEXT: ret i1 [[CMP]]
;
; AVX2-LABEL: define i1 @or_nonzero(
; AVX2-SAME: <16 x i8> [[X:%.*]]) #[[ATTR1:[0-9]+]] {
; AVX2-NEXT: [[TMP1:%.*]] = icmp ne <16 x i8> [[X]], zeroinitializer
; AVX2-NEXT: [[CMP:%.*]] = call i1 @llvm.vector.reduce.or.v16i1(<16 x i1> [[TMP1]])
; AVX2-NEXT: ret i1 [[CMP]]
;
; AVX512-LABEL: define i1 @or_nonzero(
; AVX512-SAME: <16 x i8> [[X:%.*]]) #[[ATTR1:[0-9]+]] {
; AVX512-NEXT: [[REDUCTION:%.*]] = call i8 @llvm.vector.reduce.or.v16i8(<16 x i8> [[X]])
; AVX512-NEXT: [[CMP:%.*]] = icmp ne i8 [[REDUCTION]], 0
; AVX512-NEXT: ret i1 [[CMP]]
;
%reduction = call i8 @llvm.vector.reduce.or.v16i8(<16 x i8> %x)
%cmp = icmp ne i8 %reduction, 0
ret i1 %cmp
}
define i1 @or_zero(<16 x i8> %x) {
; SSE-LABEL: define i1 @or_zero(
; SSE-SAME: <16 x i8> [[X:%.*]]) #[[ATTR1]] {
; SSE-NEXT: [[TMP1:%.*]] = icmp eq <16 x i8> [[X]], zeroinitializer
; SSE-NEXT: [[CMP:%.*]] = call i1 @llvm.vector.reduce.and.v16i1(<16 x i1> [[TMP1]])
; SSE-NEXT: ret i1 [[CMP]]
;
; AVX2-LABEL: define i1 @or_zero(
; AVX2-SAME: <16 x i8> [[X:%.*]]) #[[ATTR1]] {
; AVX2-NEXT: [[TMP1:%.*]] = icmp eq <16 x i8> [[X]], zeroinitializer
; AVX2-NEXT: [[CMP:%.*]] = call i1 @llvm.vector.reduce.and.v16i1(<16 x i1> [[TMP1]])
; AVX2-NEXT: ret i1 [[CMP]]
;
; AVX512-LABEL: define i1 @or_zero(
; AVX512-SAME: <16 x i8> [[X:%.*]]) #[[ATTR1]] {
; AVX512-NEXT: [[REDUCTION:%.*]] = call i8 @llvm.vector.reduce.or.v16i8(<16 x i8> [[X]])
; AVX512-NEXT: [[CMP:%.*]] = icmp eq i8 [[REDUCTION]], 0
; AVX512-NEXT: ret i1 [[CMP]]
;
%reduction = call i8 @llvm.vector.reduce.or.v16i8(<16 x i8> %x)
%cmp = icmp eq i8 %reduction, 0
ret i1 %cmp
}
define i1 @umax_nonzero(<16 x i8> %x) {
; SSE-LABEL: define i1 @umax_nonzero(
; SSE-SAME: <16 x i8> [[X:%.*]]) #[[ATTR1]] {
; SSE-NEXT: [[TMP1:%.*]] = icmp ne <16 x i8> [[X]], zeroinitializer
; SSE-NEXT: [[CMP:%.*]] = call i1 @llvm.vector.reduce.or.v16i1(<16 x i1> [[TMP1]])
; SSE-NEXT: ret i1 [[CMP]]
;
; AVX2-LABEL: define i1 @umax_nonzero(
; AVX2-SAME: <16 x i8> [[X:%.*]]) #[[ATTR1]] {
; AVX2-NEXT: [[TMP1:%.*]] = icmp ne <16 x i8> [[X]], zeroinitializer
; AVX2-NEXT: [[CMP:%.*]] = call i1 @llvm.vector.reduce.or.v16i1(<16 x i1> [[TMP1]])
; AVX2-NEXT: ret i1 [[CMP]]
;
; AVX512-LABEL: define i1 @umax_nonzero(
; AVX512-SAME: <16 x i8> [[X:%.*]]) #[[ATTR1]] {
; AVX512-NEXT: [[REDUCTION:%.*]] = call i8 @llvm.vector.reduce.umax.v16i8(<16 x i8> [[X]])
; AVX512-NEXT: [[CMP:%.*]] = icmp ne i8 [[REDUCTION]], 0
; AVX512-NEXT: ret i1 [[CMP]]
;
%reduction = call i8 @llvm.vector.reduce.umax.v16i8(<16 x i8> %x)
%cmp = icmp ne i8 %reduction, 0
ret i1 %cmp
}
define i1 @umax_zero_commuted(<16 x i8> %x) {
; SSE-LABEL: define i1 @umax_zero_commuted(
; SSE-SAME: <16 x i8> [[X:%.*]]) #[[ATTR1]] {
; SSE-NEXT: [[TMP1:%.*]] = icmp eq <16 x i8> [[X]], zeroinitializer
; SSE-NEXT: [[CMP:%.*]] = call i1 @llvm.vector.reduce.and.v16i1(<16 x i1> [[TMP1]])
; SSE-NEXT: ret i1 [[CMP]]
;
; AVX2-LABEL: define i1 @umax_zero_commuted(
; AVX2-SAME: <16 x i8> [[X:%.*]]) #[[ATTR1]] {
; AVX2-NEXT: [[TMP1:%.*]] = icmp eq <16 x i8> [[X]], zeroinitializer
; AVX2-NEXT: [[CMP:%.*]] = call i1 @llvm.vector.reduce.and.v16i1(<16 x i1> [[TMP1]])
; AVX2-NEXT: ret i1 [[CMP]]
;
; AVX512-LABEL: define i1 @umax_zero_commuted(
; AVX512-SAME: <16 x i8> [[X:%.*]]) #[[ATTR1]] {
; AVX512-NEXT: [[REDUCTION:%.*]] = call i8 @llvm.vector.reduce.umax.v16i8(<16 x i8> [[X]])
; AVX512-NEXT: [[CMP:%.*]] = icmp eq i8 0, [[REDUCTION]]
; AVX512-NEXT: ret i1 [[CMP]]
;
%reduction = call i8 @llvm.vector.reduce.umax.v16i8(<16 x i8> %x)
%cmp = icmp eq i8 0, %reduction
ret i1 %cmp
}
define i1 @or_nonzero_multiuse(<16 x i8> %x, ptr %out) {
; CHECK-LABEL: define i1 @or_nonzero_multiuse(
; CHECK-SAME: <16 x i8> [[X:%.*]], ptr [[OUT:%.*]]) #[[ATTR1:[0-9]+]] {
; CHECK-NEXT: [[REDUCTION:%.*]] = call i8 @llvm.vector.reduce.or.v16i8(<16 x i8> [[X]])
; CHECK-NEXT: store i8 [[REDUCTION]], ptr [[OUT]], align 1
; CHECK-NEXT: [[CMP:%.*]] = icmp ne i8 [[REDUCTION]], 0
; CHECK-NEXT: ret i1 [[CMP]]
;
%reduction = call i8 @llvm.vector.reduce.or.v16i8(<16 x i8> %x)
store i8 %reduction, ptr %out, align 1
%cmp = icmp ne i8 %reduction, 0
ret i1 %cmp
}