blob: b2b71da3898a451bbf4d2a0b927ddff5643d307a [file]
; NOTE: Assertions have been autogenerated by utils/update_llc_test_checks.py UTC_ARGS: --version 5
; RUN: llc -mtriple=riscv32 -mattr=+zilsd -verify-machineinstrs < %s \
; RUN: | FileCheck -check-prefixes=CHECK,SLOW %s
; RUN: llc -mtriple=riscv32 -mattr=+zilsd,+unaligned-scalar-mem -verify-machineinstrs < %s \
; RUN: | FileCheck -check-prefixes=CHECK,FAST %s
; RUN: llc -mtriple=riscv32 -mattr=+zilsd,+zilsd-word-align -verify-machineinstrs < %s \
; RUN: | FileCheck -check-prefixes=CHECK,4BYTEALIGN %s
define i64 @load(ptr %a) nounwind {
; CHECK-LABEL: load:
; CHECK: # %bb.0:
; CHECK-NEXT: mv a2, a0
; CHECK-NEXT: ld a0, 80(a0)
; CHECK-NEXT: ld zero, 0(a2)
; CHECK-NEXT: ret
%1 = getelementptr i64, ptr %a, i32 10
%2 = load i64, ptr %1
%3 = load volatile i64, ptr %a
ret i64 %2
}
define i64 @load_align4(ptr %a) nounwind {
; SLOW-LABEL: load_align4:
; SLOW: # %bb.0:
; SLOW-NEXT: lw a2, 80(a0)
; SLOW-NEXT: lw a1, 84(a0)
; SLOW-NEXT: mv a0, a2
; SLOW-NEXT: ret
;
; FAST-LABEL: load_align4:
; FAST: # %bb.0:
; FAST-NEXT: ld a0, 80(a0)
; FAST-NEXT: ret
;
; 4BYTEALIGN-LABEL: load_align4:
; 4BYTEALIGN: # %bb.0:
; 4BYTEALIGN-NEXT: ld a0, 80(a0)
; 4BYTEALIGN-NEXT: ret
%1 = getelementptr i64, ptr %a, i32 10
%2 = load i64, ptr %1, align 4
ret i64 %2
}
define void @store(ptr %a, i64 %b) nounwind {
; CHECK-LABEL: store:
; CHECK: # %bb.0:
; CHECK-NEXT: mv a3, a2
; CHECK-NEXT: mv a2, a1
; CHECK-NEXT: sd a2, 0(a0)
; CHECK-NEXT: sd a2, 88(a0)
; CHECK-NEXT: ret
store i64 %b, ptr %a
%1 = getelementptr i64, ptr %a, i32 11
store i64 %b, ptr %1
ret void
}
define void @store_align4(ptr %a, i64 %b) nounwind {
; SLOW-LABEL: store_align4:
; SLOW: # %bb.0:
; SLOW-NEXT: sw a1, 88(a0)
; SLOW-NEXT: sw a2, 92(a0)
; SLOW-NEXT: ret
;
; FAST-LABEL: store_align4:
; FAST: # %bb.0:
; FAST-NEXT: mv a3, a2
; FAST-NEXT: mv a2, a1
; FAST-NEXT: sd a2, 88(a0)
; FAST-NEXT: ret
;
; 4BYTEALIGN-LABEL: store_align4:
; 4BYTEALIGN: # %bb.0:
; 4BYTEALIGN-NEXT: mv a3, a2
; 4BYTEALIGN-NEXT: mv a2, a1
; 4BYTEALIGN-NEXT: sd a2, 88(a0)
; 4BYTEALIGN-NEXT: ret
%1 = getelementptr i64, ptr %a, i32 11
store i64 %b, ptr %1, align 4
ret void
}
define i64 @load_unaligned(ptr %p) {
; SLOW-LABEL: load_unaligned:
; SLOW: # %bb.0:
; SLOW-NEXT: lbu a1, 1(a0)
; SLOW-NEXT: lbu a2, 0(a0)
; SLOW-NEXT: lbu a3, 2(a0)
; SLOW-NEXT: lbu a4, 3(a0)
; SLOW-NEXT: slli a1, a1, 8
; SLOW-NEXT: lbu a5, 5(a0)
; SLOW-NEXT: lbu a6, 6(a0)
; SLOW-NEXT: lbu a7, 7(a0)
; SLOW-NEXT: lbu a0, 4(a0)
; SLOW-NEXT: or a1, a1, a2
; SLOW-NEXT: slli a3, a3, 16
; SLOW-NEXT: slli a4, a4, 24
; SLOW-NEXT: or a3, a4, a3
; SLOW-NEXT: slli a5, a5, 8
; SLOW-NEXT: slli a6, a6, 16
; SLOW-NEXT: slli a7, a7, 24
; SLOW-NEXT: or a5, a5, a0
; SLOW-NEXT: or a2, a7, a6
; SLOW-NEXT: or a0, a3, a1
; SLOW-NEXT: or a1, a2, a5
; SLOW-NEXT: ret
;
; FAST-LABEL: load_unaligned:
; FAST: # %bb.0:
; FAST-NEXT: ld a0, 0(a0)
; FAST-NEXT: ret
;
; 4BYTEALIGN-LABEL: load_unaligned:
; 4BYTEALIGN: # %bb.0:
; 4BYTEALIGN-NEXT: lbu a1, 1(a0)
; 4BYTEALIGN-NEXT: lbu a2, 0(a0)
; 4BYTEALIGN-NEXT: lbu a3, 2(a0)
; 4BYTEALIGN-NEXT: lbu a4, 3(a0)
; 4BYTEALIGN-NEXT: slli a1, a1, 8
; 4BYTEALIGN-NEXT: lbu a5, 5(a0)
; 4BYTEALIGN-NEXT: lbu a6, 6(a0)
; 4BYTEALIGN-NEXT: lbu a7, 7(a0)
; 4BYTEALIGN-NEXT: lbu a0, 4(a0)
; 4BYTEALIGN-NEXT: or a1, a1, a2
; 4BYTEALIGN-NEXT: slli a3, a3, 16
; 4BYTEALIGN-NEXT: slli a4, a4, 24
; 4BYTEALIGN-NEXT: or a3, a4, a3
; 4BYTEALIGN-NEXT: slli a5, a5, 8
; 4BYTEALIGN-NEXT: slli a6, a6, 16
; 4BYTEALIGN-NEXT: slli a7, a7, 24
; 4BYTEALIGN-NEXT: or a5, a5, a0
; 4BYTEALIGN-NEXT: or a2, a7, a6
; 4BYTEALIGN-NEXT: or a0, a3, a1
; 4BYTEALIGN-NEXT: or a1, a2, a5
; 4BYTEALIGN-NEXT: ret
%res = load i64, ptr %p, align 1
ret i64 %res
}
define void @store_unaligned(ptr %p, i64 %v) {
; SLOW-LABEL: store_unaligned:
; SLOW: # %bb.0:
; SLOW-NEXT: srli a3, a2, 24
; SLOW-NEXT: srli a4, a2, 16
; SLOW-NEXT: srli a5, a2, 8
; SLOW-NEXT: sb a2, 4(a0)
; SLOW-NEXT: sb a5, 5(a0)
; SLOW-NEXT: sb a4, 6(a0)
; SLOW-NEXT: sb a3, 7(a0)
; SLOW-NEXT: srli a2, a1, 24
; SLOW-NEXT: srli a3, a1, 16
; SLOW-NEXT: srli a4, a1, 8
; SLOW-NEXT: sb a1, 0(a0)
; SLOW-NEXT: sb a4, 1(a0)
; SLOW-NEXT: sb a3, 2(a0)
; SLOW-NEXT: sb a2, 3(a0)
; SLOW-NEXT: ret
;
; FAST-LABEL: store_unaligned:
; FAST: # %bb.0:
; FAST-NEXT: mv a3, a2
; FAST-NEXT: mv a2, a1
; FAST-NEXT: sd a2, 0(a0)
; FAST-NEXT: ret
;
; 4BYTEALIGN-LABEL: store_unaligned:
; 4BYTEALIGN: # %bb.0:
; 4BYTEALIGN-NEXT: srli a3, a2, 24
; 4BYTEALIGN-NEXT: srli a4, a2, 16
; 4BYTEALIGN-NEXT: srli a5, a2, 8
; 4BYTEALIGN-NEXT: sb a2, 4(a0)
; 4BYTEALIGN-NEXT: sb a5, 5(a0)
; 4BYTEALIGN-NEXT: sb a4, 6(a0)
; 4BYTEALIGN-NEXT: sb a3, 7(a0)
; 4BYTEALIGN-NEXT: srli a2, a1, 24
; 4BYTEALIGN-NEXT: srli a3, a1, 16
; 4BYTEALIGN-NEXT: srli a4, a1, 8
; 4BYTEALIGN-NEXT: sb a1, 0(a0)
; 4BYTEALIGN-NEXT: sb a4, 1(a0)
; 4BYTEALIGN-NEXT: sb a3, 2(a0)
; 4BYTEALIGN-NEXT: sb a2, 3(a0)
; 4BYTEALIGN-NEXT: ret
store i64 %v, ptr %p, align 1
ret void
}
@g = dso_local global i64 0, align 8
define i64 @load_g() nounwind {
; CHECK-LABEL: load_g:
; CHECK: # %bb.0: # %entry
; CHECK-NEXT: lui a0, %hi(g)
; CHECK-NEXT: ld a0, %lo(g)(a0)
; CHECK-NEXT: ret
entry:
%0 = load i64, ptr @g
ret i64 %0
}
define void @store_g() nounwind {
; CHECK-LABEL: store_g:
; CHECK: # %bb.0: # %entyr
; CHECK-NEXT: lui a0, %hi(g)
; CHECK-NEXT: sd zero, %lo(g)(a0)
; CHECK-NEXT: ret
entyr:
store i64 0, ptr @g
ret void
}
define void @large_offset(ptr nocapture %p, i64 %d) nounwind {
; CHECK-LABEL: large_offset:
; CHECK: # %bb.0: # %entry
; CHECK-NEXT: lui a1, 4
; CHECK-NEXT: add a0, a0, a1
; CHECK-NEXT: ld a2, -384(a0)
; CHECK-NEXT: addi a2, a2, 1
; CHECK-NEXT: seqz a1, a2
; CHECK-NEXT: add a3, a3, a1
; CHECK-NEXT: sd a2, -384(a0)
; CHECK-NEXT: ret
entry:
%add.ptr = getelementptr inbounds i64, ptr %p, i64 2000
%a = load i64, ptr %add.ptr, align 8
%b = add i64 %a, 1
store i64 %b, ptr %add.ptr, align 8
ret void
}
define void @fold_frame_idx(i32 %val1, i32 %val2, ptr nocapture %p) nounwind {
; SLOW-LABEL: fold_frame_idx:
; SLOW: # %bb.0: # %entry
; SLOW-NEXT: addi sp, sp, -400
; SLOW-NEXT: sw a0, 40(sp)
; SLOW-NEXT: sw a1, 44(sp)
; SLOW-NEXT: addi sp, sp, 400
; SLOW-NEXT: ret
;
; FAST-LABEL: fold_frame_idx:
; FAST: # %bb.0: # %entry
; FAST-NEXT: addi sp, sp, -400
; FAST-NEXT: sd a0, 40(sp)
; FAST-NEXT: addi sp, sp, 400
; FAST-NEXT: ret
;
; 4BYTEALIGN-LABEL: fold_frame_idx:
; 4BYTEALIGN: # %bb.0: # %entry
; 4BYTEALIGN-NEXT: addi sp, sp, -400
; 4BYTEALIGN-NEXT: sd a0, 40(sp)
; 4BYTEALIGN-NEXT: addi sp, sp, 400
; 4BYTEALIGN-NEXT: ret
entry:
%local = alloca [100 x i32]
%local.ptr = getelementptr inbounds i32, ptr %local, i64 10
%local1.ptr = getelementptr inbounds i32, ptr %local, i64 11
store i32 %val1, ptr %local.ptr, align 4
store i32 %val2, ptr %local1.ptr, align 4
ret void
}
define void @dont_fold_frame_idx(ptr nocapture %p, i32 %val1, i32 %val2) nounwind {
; CHECK-LABEL: dont_fold_frame_idx:
; CHECK: # %bb.0: # %entry
; CHECK-NEXT: addi sp, sp, -400
; CHECK-NEXT: sw a1, 40(sp)
; CHECK-NEXT: sw a2, 44(sp)
; CHECK-NEXT: addi sp, sp, 400
; CHECK-NEXT: ret
entry:
%local = alloca [100 x i32]
%local.ptr = getelementptr inbounds i32, ptr %local, i64 10
%local1.ptr = getelementptr inbounds i32, ptr %local, i64 11
store i32 %val1, ptr %local.ptr, align 4
store i32 %val2, ptr %local1.ptr, align 4
ret void
}
define void @basic_store_zero_combine(ptr %0, i32 %1, i32 %2) {
; CHECK-LABEL: basic_store_zero_combine:
; CHECK: # %bb.0:
; CHECK-NEXT: sw zero, 0(a0)
; CHECK-NEXT: sw zero, 4(a0)
; CHECK-NEXT: ret
store i32 0, ptr %0, align 4
%4 = getelementptr inbounds i32, ptr %0, i32 1
store i32 0, ptr %4, align 4
ret void
}
declare void @llvm.memset.p0.i32(ptr, i8, i32, i1 immarg)
define void @no_coalesce() #0 {
; CHECK-LABEL: no_coalesce:
; CHECK: # %bb.0: # %entry
; CHECK-NEXT: li a1, 0
; CHECK-NEXT: li a0, 1
; CHECK-NEXT: j .LBB12_2
; CHECK-NEXT: .LBB12_1: # %crash
; CHECK-NEXT: # in Loop: Header=BB12_2 Depth=1
; CHECK-NEXT: sd a0, 0(zero)
; CHECK-NEXT: sw a1, 8(zero)
; CHECK-NEXT: sw a1, 0(zero)
; CHECK-NEXT: sw a1, 4(zero)
; CHECK-NEXT: .LBB12_2: # %loop
; CHECK-NEXT: # =>This Inner Loop Header: Depth=1
; CHECK-NEXT: bnez a1, .LBB12_1
; CHECK-NEXT: # %bb.3: # %loop
; CHECK-NEXT: # in Loop: Header=BB12_2 Depth=1
; CHECK-NEXT: beqz a1, .LBB12_2
; CHECK-NEXT: # %bb.4: # %exit
; CHECK-NEXT: ret
entry:
br label %loop
loop:
switch i8 0, label %loop [
i8 1, label %crash
i8 3, label %exit
]
crash:
store i64 1, ptr null, align 8
call void @llvm.memset.p0.i32(ptr null, i8 0, i32 12, i1 false)
br label %loop
exit:
ret void
}