| ; NOTE: Assertions have been autogenerated by utils/update_llc_test_checks.py UTC_ARGS: --version 5 |
| ; RUN: llc -mtriple=riscv32 -mattr=+zilsd -verify-machineinstrs < %s \ |
| ; RUN: | FileCheck -check-prefixes=CHECK,SLOW %s |
| ; RUN: llc -mtriple=riscv32 -mattr=+zilsd,+unaligned-scalar-mem -verify-machineinstrs < %s \ |
| ; RUN: | FileCheck -check-prefixes=CHECK,FAST %s |
| ; RUN: llc -mtriple=riscv32 -mattr=+zilsd,+zilsd-word-align -verify-machineinstrs < %s \ |
| ; RUN: | FileCheck -check-prefixes=CHECK,4BYTEALIGN %s |
| |
| define i64 @load(ptr %a) nounwind { |
| ; CHECK-LABEL: load: |
| ; CHECK: # %bb.0: |
| ; CHECK-NEXT: mv a2, a0 |
| ; CHECK-NEXT: ld a0, 80(a0) |
| ; CHECK-NEXT: ld zero, 0(a2) |
| ; CHECK-NEXT: ret |
| %1 = getelementptr i64, ptr %a, i32 10 |
| %2 = load i64, ptr %1 |
| %3 = load volatile i64, ptr %a |
| ret i64 %2 |
| } |
| |
| define i64 @load_align4(ptr %a) nounwind { |
| ; SLOW-LABEL: load_align4: |
| ; SLOW: # %bb.0: |
| ; SLOW-NEXT: lw a2, 80(a0) |
| ; SLOW-NEXT: lw a1, 84(a0) |
| ; SLOW-NEXT: mv a0, a2 |
| ; SLOW-NEXT: ret |
| ; |
| ; FAST-LABEL: load_align4: |
| ; FAST: # %bb.0: |
| ; FAST-NEXT: ld a0, 80(a0) |
| ; FAST-NEXT: ret |
| ; |
| ; 4BYTEALIGN-LABEL: load_align4: |
| ; 4BYTEALIGN: # %bb.0: |
| ; 4BYTEALIGN-NEXT: ld a0, 80(a0) |
| ; 4BYTEALIGN-NEXT: ret |
| %1 = getelementptr i64, ptr %a, i32 10 |
| %2 = load i64, ptr %1, align 4 |
| ret i64 %2 |
| } |
| |
| define void @store(ptr %a, i64 %b) nounwind { |
| ; CHECK-LABEL: store: |
| ; CHECK: # %bb.0: |
| ; CHECK-NEXT: mv a3, a2 |
| ; CHECK-NEXT: mv a2, a1 |
| ; CHECK-NEXT: sd a2, 0(a0) |
| ; CHECK-NEXT: sd a2, 88(a0) |
| ; CHECK-NEXT: ret |
| store i64 %b, ptr %a |
| %1 = getelementptr i64, ptr %a, i32 11 |
| store i64 %b, ptr %1 |
| ret void |
| } |
| |
| define void @store_align4(ptr %a, i64 %b) nounwind { |
| ; SLOW-LABEL: store_align4: |
| ; SLOW: # %bb.0: |
| ; SLOW-NEXT: sw a1, 88(a0) |
| ; SLOW-NEXT: sw a2, 92(a0) |
| ; SLOW-NEXT: ret |
| ; |
| ; FAST-LABEL: store_align4: |
| ; FAST: # %bb.0: |
| ; FAST-NEXT: mv a3, a2 |
| ; FAST-NEXT: mv a2, a1 |
| ; FAST-NEXT: sd a2, 88(a0) |
| ; FAST-NEXT: ret |
| ; |
| ; 4BYTEALIGN-LABEL: store_align4: |
| ; 4BYTEALIGN: # %bb.0: |
| ; 4BYTEALIGN-NEXT: mv a3, a2 |
| ; 4BYTEALIGN-NEXT: mv a2, a1 |
| ; 4BYTEALIGN-NEXT: sd a2, 88(a0) |
| ; 4BYTEALIGN-NEXT: ret |
| %1 = getelementptr i64, ptr %a, i32 11 |
| store i64 %b, ptr %1, align 4 |
| ret void |
| } |
| |
| define i64 @load_unaligned(ptr %p) { |
| ; SLOW-LABEL: load_unaligned: |
| ; SLOW: # %bb.0: |
| ; SLOW-NEXT: lbu a1, 1(a0) |
| ; SLOW-NEXT: lbu a2, 0(a0) |
| ; SLOW-NEXT: lbu a3, 2(a0) |
| ; SLOW-NEXT: lbu a4, 3(a0) |
| ; SLOW-NEXT: slli a1, a1, 8 |
| ; SLOW-NEXT: lbu a5, 5(a0) |
| ; SLOW-NEXT: lbu a6, 6(a0) |
| ; SLOW-NEXT: lbu a7, 7(a0) |
| ; SLOW-NEXT: lbu a0, 4(a0) |
| ; SLOW-NEXT: or a1, a1, a2 |
| ; SLOW-NEXT: slli a3, a3, 16 |
| ; SLOW-NEXT: slli a4, a4, 24 |
| ; SLOW-NEXT: or a3, a4, a3 |
| ; SLOW-NEXT: slli a5, a5, 8 |
| ; SLOW-NEXT: slli a6, a6, 16 |
| ; SLOW-NEXT: slli a7, a7, 24 |
| ; SLOW-NEXT: or a5, a5, a0 |
| ; SLOW-NEXT: or a2, a7, a6 |
| ; SLOW-NEXT: or a0, a3, a1 |
| ; SLOW-NEXT: or a1, a2, a5 |
| ; SLOW-NEXT: ret |
| ; |
| ; FAST-LABEL: load_unaligned: |
| ; FAST: # %bb.0: |
| ; FAST-NEXT: ld a0, 0(a0) |
| ; FAST-NEXT: ret |
| ; |
| ; 4BYTEALIGN-LABEL: load_unaligned: |
| ; 4BYTEALIGN: # %bb.0: |
| ; 4BYTEALIGN-NEXT: lbu a1, 1(a0) |
| ; 4BYTEALIGN-NEXT: lbu a2, 0(a0) |
| ; 4BYTEALIGN-NEXT: lbu a3, 2(a0) |
| ; 4BYTEALIGN-NEXT: lbu a4, 3(a0) |
| ; 4BYTEALIGN-NEXT: slli a1, a1, 8 |
| ; 4BYTEALIGN-NEXT: lbu a5, 5(a0) |
| ; 4BYTEALIGN-NEXT: lbu a6, 6(a0) |
| ; 4BYTEALIGN-NEXT: lbu a7, 7(a0) |
| ; 4BYTEALIGN-NEXT: lbu a0, 4(a0) |
| ; 4BYTEALIGN-NEXT: or a1, a1, a2 |
| ; 4BYTEALIGN-NEXT: slli a3, a3, 16 |
| ; 4BYTEALIGN-NEXT: slli a4, a4, 24 |
| ; 4BYTEALIGN-NEXT: or a3, a4, a3 |
| ; 4BYTEALIGN-NEXT: slli a5, a5, 8 |
| ; 4BYTEALIGN-NEXT: slli a6, a6, 16 |
| ; 4BYTEALIGN-NEXT: slli a7, a7, 24 |
| ; 4BYTEALIGN-NEXT: or a5, a5, a0 |
| ; 4BYTEALIGN-NEXT: or a2, a7, a6 |
| ; 4BYTEALIGN-NEXT: or a0, a3, a1 |
| ; 4BYTEALIGN-NEXT: or a1, a2, a5 |
| ; 4BYTEALIGN-NEXT: ret |
| %res = load i64, ptr %p, align 1 |
| ret i64 %res |
| } |
| |
| define void @store_unaligned(ptr %p, i64 %v) { |
| ; SLOW-LABEL: store_unaligned: |
| ; SLOW: # %bb.0: |
| ; SLOW-NEXT: srli a3, a2, 24 |
| ; SLOW-NEXT: srli a4, a2, 16 |
| ; SLOW-NEXT: srli a5, a2, 8 |
| ; SLOW-NEXT: sb a2, 4(a0) |
| ; SLOW-NEXT: sb a5, 5(a0) |
| ; SLOW-NEXT: sb a4, 6(a0) |
| ; SLOW-NEXT: sb a3, 7(a0) |
| ; SLOW-NEXT: srli a2, a1, 24 |
| ; SLOW-NEXT: srli a3, a1, 16 |
| ; SLOW-NEXT: srli a4, a1, 8 |
| ; SLOW-NEXT: sb a1, 0(a0) |
| ; SLOW-NEXT: sb a4, 1(a0) |
| ; SLOW-NEXT: sb a3, 2(a0) |
| ; SLOW-NEXT: sb a2, 3(a0) |
| ; SLOW-NEXT: ret |
| ; |
| ; FAST-LABEL: store_unaligned: |
| ; FAST: # %bb.0: |
| ; FAST-NEXT: mv a3, a2 |
| ; FAST-NEXT: mv a2, a1 |
| ; FAST-NEXT: sd a2, 0(a0) |
| ; FAST-NEXT: ret |
| ; |
| ; 4BYTEALIGN-LABEL: store_unaligned: |
| ; 4BYTEALIGN: # %bb.0: |
| ; 4BYTEALIGN-NEXT: srli a3, a2, 24 |
| ; 4BYTEALIGN-NEXT: srli a4, a2, 16 |
| ; 4BYTEALIGN-NEXT: srli a5, a2, 8 |
| ; 4BYTEALIGN-NEXT: sb a2, 4(a0) |
| ; 4BYTEALIGN-NEXT: sb a5, 5(a0) |
| ; 4BYTEALIGN-NEXT: sb a4, 6(a0) |
| ; 4BYTEALIGN-NEXT: sb a3, 7(a0) |
| ; 4BYTEALIGN-NEXT: srli a2, a1, 24 |
| ; 4BYTEALIGN-NEXT: srli a3, a1, 16 |
| ; 4BYTEALIGN-NEXT: srli a4, a1, 8 |
| ; 4BYTEALIGN-NEXT: sb a1, 0(a0) |
| ; 4BYTEALIGN-NEXT: sb a4, 1(a0) |
| ; 4BYTEALIGN-NEXT: sb a3, 2(a0) |
| ; 4BYTEALIGN-NEXT: sb a2, 3(a0) |
| ; 4BYTEALIGN-NEXT: ret |
| store i64 %v, ptr %p, align 1 |
| ret void |
| } |
| |
| @g = dso_local global i64 0, align 8 |
| |
| define i64 @load_g() nounwind { |
| ; CHECK-LABEL: load_g: |
| ; CHECK: # %bb.0: # %entry |
| ; CHECK-NEXT: lui a0, %hi(g) |
| ; CHECK-NEXT: ld a0, %lo(g)(a0) |
| ; CHECK-NEXT: ret |
| entry: |
| %0 = load i64, ptr @g |
| ret i64 %0 |
| } |
| |
| define void @store_g() nounwind { |
| ; CHECK-LABEL: store_g: |
| ; CHECK: # %bb.0: # %entyr |
| ; CHECK-NEXT: lui a0, %hi(g) |
| ; CHECK-NEXT: sd zero, %lo(g)(a0) |
| ; CHECK-NEXT: ret |
| entyr: |
| store i64 0, ptr @g |
| ret void |
| } |
| |
| define void @large_offset(ptr nocapture %p, i64 %d) nounwind { |
| ; CHECK-LABEL: large_offset: |
| ; CHECK: # %bb.0: # %entry |
| ; CHECK-NEXT: lui a1, 4 |
| ; CHECK-NEXT: add a0, a0, a1 |
| ; CHECK-NEXT: ld a2, -384(a0) |
| ; CHECK-NEXT: addi a2, a2, 1 |
| ; CHECK-NEXT: seqz a1, a2 |
| ; CHECK-NEXT: add a3, a3, a1 |
| ; CHECK-NEXT: sd a2, -384(a0) |
| ; CHECK-NEXT: ret |
| entry: |
| %add.ptr = getelementptr inbounds i64, ptr %p, i64 2000 |
| %a = load i64, ptr %add.ptr, align 8 |
| %b = add i64 %a, 1 |
| store i64 %b, ptr %add.ptr, align 8 |
| ret void |
| } |
| |
| define void @fold_frame_idx(i32 %val1, i32 %val2, ptr nocapture %p) nounwind { |
| ; SLOW-LABEL: fold_frame_idx: |
| ; SLOW: # %bb.0: # %entry |
| ; SLOW-NEXT: addi sp, sp, -400 |
| ; SLOW-NEXT: sw a0, 40(sp) |
| ; SLOW-NEXT: sw a1, 44(sp) |
| ; SLOW-NEXT: addi sp, sp, 400 |
| ; SLOW-NEXT: ret |
| ; |
| ; FAST-LABEL: fold_frame_idx: |
| ; FAST: # %bb.0: # %entry |
| ; FAST-NEXT: addi sp, sp, -400 |
| ; FAST-NEXT: sd a0, 40(sp) |
| ; FAST-NEXT: addi sp, sp, 400 |
| ; FAST-NEXT: ret |
| ; |
| ; 4BYTEALIGN-LABEL: fold_frame_idx: |
| ; 4BYTEALIGN: # %bb.0: # %entry |
| ; 4BYTEALIGN-NEXT: addi sp, sp, -400 |
| ; 4BYTEALIGN-NEXT: sd a0, 40(sp) |
| ; 4BYTEALIGN-NEXT: addi sp, sp, 400 |
| ; 4BYTEALIGN-NEXT: ret |
| entry: |
| %local = alloca [100 x i32] |
| %local.ptr = getelementptr inbounds i32, ptr %local, i64 10 |
| %local1.ptr = getelementptr inbounds i32, ptr %local, i64 11 |
| store i32 %val1, ptr %local.ptr, align 4 |
| store i32 %val2, ptr %local1.ptr, align 4 |
| ret void |
| } |
| |
| define void @dont_fold_frame_idx(ptr nocapture %p, i32 %val1, i32 %val2) nounwind { |
| ; CHECK-LABEL: dont_fold_frame_idx: |
| ; CHECK: # %bb.0: # %entry |
| ; CHECK-NEXT: addi sp, sp, -400 |
| ; CHECK-NEXT: sw a1, 40(sp) |
| ; CHECK-NEXT: sw a2, 44(sp) |
| ; CHECK-NEXT: addi sp, sp, 400 |
| ; CHECK-NEXT: ret |
| entry: |
| %local = alloca [100 x i32] |
| %local.ptr = getelementptr inbounds i32, ptr %local, i64 10 |
| %local1.ptr = getelementptr inbounds i32, ptr %local, i64 11 |
| store i32 %val1, ptr %local.ptr, align 4 |
| store i32 %val2, ptr %local1.ptr, align 4 |
| ret void |
| } |
| |
| define void @basic_store_zero_combine(ptr %0, i32 %1, i32 %2) { |
| ; CHECK-LABEL: basic_store_zero_combine: |
| ; CHECK: # %bb.0: |
| ; CHECK-NEXT: sw zero, 0(a0) |
| ; CHECK-NEXT: sw zero, 4(a0) |
| ; CHECK-NEXT: ret |
| store i32 0, ptr %0, align 4 |
| %4 = getelementptr inbounds i32, ptr %0, i32 1 |
| store i32 0, ptr %4, align 4 |
| ret void |
| } |
| |
| declare void @llvm.memset.p0.i32(ptr, i8, i32, i1 immarg) |
| |
| define void @no_coalesce() #0 { |
| ; CHECK-LABEL: no_coalesce: |
| ; CHECK: # %bb.0: # %entry |
| ; CHECK-NEXT: li a1, 0 |
| ; CHECK-NEXT: li a0, 1 |
| ; CHECK-NEXT: j .LBB12_2 |
| ; CHECK-NEXT: .LBB12_1: # %crash |
| ; CHECK-NEXT: # in Loop: Header=BB12_2 Depth=1 |
| ; CHECK-NEXT: sd a0, 0(zero) |
| ; CHECK-NEXT: sw a1, 8(zero) |
| ; CHECK-NEXT: sw a1, 0(zero) |
| ; CHECK-NEXT: sw a1, 4(zero) |
| ; CHECK-NEXT: .LBB12_2: # %loop |
| ; CHECK-NEXT: # =>This Inner Loop Header: Depth=1 |
| ; CHECK-NEXT: bnez a1, .LBB12_1 |
| ; CHECK-NEXT: # %bb.3: # %loop |
| ; CHECK-NEXT: # in Loop: Header=BB12_2 Depth=1 |
| ; CHECK-NEXT: beqz a1, .LBB12_2 |
| ; CHECK-NEXT: # %bb.4: # %exit |
| ; CHECK-NEXT: ret |
| entry: |
| br label %loop |
| |
| loop: |
| switch i8 0, label %loop [ |
| i8 1, label %crash |
| i8 3, label %exit |
| ] |
| |
| crash: |
| store i64 1, ptr null, align 8 |
| call void @llvm.memset.p0.i32(ptr null, i8 0, i32 12, i1 false) |
| br label %loop |
| |
| exit: |
| ret void |
| } |