X86: Pattern match scalar loads + vcvtph2ps into just vcvtph2ps.

author Benjamin Kramer <benny.kra@googlemail.com>

Fri, 18 Apr 2014 10:45:33 +0000 (10:45 +0000)

committer Benjamin Kramer <benny.kra@googlemail.com>

Fri, 18 Apr 2014 10:45:33 +0000 (10:45 +0000)
author Benjamin Kramer <benny.kra@googlemail.com>
Fri, 18 Apr 2014 10:45:33 +0000 (10:45 +0000)
committer Benjamin Kramer <benny.kra@googlemail.com>
Fri, 18 Apr 2014 10:45:33 +0000 (10:45 +0000)
diff --git a/lib/Target/X86/X86InstrSSE.td b/lib/Target/X86/X86InstrSSE.td

index 72a18e7d794cd2263ef9af06b8a84c1071117f82..c49777516da6a033d7876d69abfee491eba70cf1 100644 (file)
--- a/lib/Target/X86/X86InstrSSE.td
+++ b/lib/Target/X86/X86InstrSSE.td
@@ -8304,6 +8304,12 @@ let Predicates = [HasF16C] in {
    defm VCVTPH2PSY : f16c_ph2ps<VR256, f128mem, int_x86_vcvtph2ps_256>, VEX_L;
    defm VCVTPS2PH  : f16c_ps2ph<VR128, f64mem, int_x86_vcvtps2ph_128>;
    defm VCVTPS2PHY : f16c_ps2ph<VR256, f128mem, int_x86_vcvtps2ph_256>, VEX_L;
+
+  // Pattern match vcvtph2ps of a scalar i64 load.
+  def : Pat<(int_x86_vcvtph2ps_128 (vzmovl_v2i64 addr:$src)),
+            (VCVTPH2PSrm addr:$src)>;
+  def : Pat<(int_x86_vcvtph2ps_128 (vzload_v2i64 addr:$src)),
+            (VCVTPH2PSrm addr:$src)>;
  }
  
  //===----------------------------------------------------------------------===//
diff --git a/test/CodeGen/X86/f16c-intrinsics.ll b/test/CodeGen/X86/f16c-intrinsics.ll

index 2135f9409cfe6f53b5d905d163a2c9c1f2f93dd6..514d929f4432e0e74fb0cfd576ef594d4a821a9b 100644 (file)
--- a/test/CodeGen/X86/f16c-intrinsics.ll
+++ b/test/CodeGen/X86/f16c-intrinsics.ll
@@ -1,4 +1,5 @@
  ; RUN: llc < %s -march=x86 -mattr=+avx,+f16c | FileCheck %s
+; RUN: llc < %s -march=x86-64 -mattr=+avx,+f16c | FileCheck %s
  
  define <4 x float> @test_x86_vcvtph2ps_128(<8 x i16> %a0) {
    ; CHECK: vcvtph2ps
@@ -30,3 +31,16 @@ define <8 x i16> @test_x86_vcvtps2ph_256(<8 x float> %a0) {
    ret <8 x i16> %res
  }
  declare <8 x i16> @llvm.x86.vcvtps2ph.256(<8 x float>, i32) nounwind readonly
+
+define <4 x float> @test_x86_vcvtps2ph_128_scalar(i64* %ptr) {
+; CHECK-LABEL: test_x86_vcvtps2ph_128_scalar
+; CHECK-NOT: vmov
+; CHECK: vcvtph2ps (%
+
+  %load = load i64* %ptr
+  %ins1 = insertelement <2 x i64> undef, i64 %load, i32 0
+  %ins2 = insertelement <2 x i64> %ins1, i64 0, i32 1
+  %bc = bitcast <2 x i64> %ins2 to <8 x i16>
+  %res = tail call <4 x float> @llvm.x86.vcvtph2ps.128(<8 x i16> %bc) #2
+  ret <4 x float> %res
+}
author	Benjamin Kramer <benny.kra@googlemail.com>
	Fri, 18 Apr 2014 10:45:33 +0000 (10:45 +0000)
committer	Benjamin Kramer <benny.kra@googlemail.com>
	Fri, 18 Apr 2014 10:45:33 +0000 (10:45 +0000)
lib/Target/X86/X86InstrSSE.td		patch \| blob \| history
test/CodeGen/X86/f16c-intrinsics.ll		patch \| blob \| history