Guard fabs to bfc convert with V6T2 flag

[oota-llvm.git] / lib / Target / ARM / ARMInstrVFP.td
diff --git a/lib/Target/ARM/ARMInstrVFP.td b/lib/Target/ARM/ARMInstrVFP.td

index 0912b473cbb522bcd2822c8bcf2232239957a72a..63e7940bb14ee7cee5ed91182c0ab9ccb7271ac8 100644 (file)
--- a/lib/Target/ARM/ARMInstrVFP.td
+++ b/lib/Target/ARM/ARMInstrVFP.td
@@ -11,22 +11,15 @@
  //
  //===----------------------------------------------------------------------===//
  
-def SDT_FTOI    : SDTypeProfile<1, 1, [SDTCisVT<0, f32>, SDTCisFP<1>]>;
-def SDT_ITOF    : SDTypeProfile<1, 1, [SDTCisFP<0>, SDTCisVT<1, f32>]>;
  def SDT_CMPFP0  : SDTypeProfile<0, 1, [SDTCisFP<0>]>;
  def SDT_VMOVDRR : SDTypeProfile<1, 2, [SDTCisVT<0, f64>, SDTCisVT<1, i32>,
                                         SDTCisSameAs<1, 2>]>;
  
-def arm_ftoui  : SDNode<"ARMISD::FTOUI",   SDT_FTOI>;
-def arm_ftosi  : SDNode<"ARMISD::FTOSI",   SDT_FTOI>;
-def arm_sitof  : SDNode<"ARMISD::SITOF",   SDT_ITOF>;
-def arm_uitof  : SDNode<"ARMISD::UITOF",   SDT_ITOF>;
  def arm_fmstat : SDNode<"ARMISD::FMSTAT",  SDTNone, [SDNPInGlue, SDNPOutGlue]>;
  def arm_cmpfp  : SDNode<"ARMISD::CMPFP",   SDT_ARMCmp, [SDNPOutGlue]>;
  def arm_cmpfp0 : SDNode<"ARMISD::CMPFPw0", SDT_CMPFP0, [SDNPOutGlue]>;
  def arm_fmdrr  : SDNode<"ARMISD::VMOVDRR", SDT_VMOVDRR>;
  
-
  //===----------------------------------------------------------------------===//
  // Operand Definitions.
  //
@@ -43,7 +36,7 @@ def vfp_f32imm : Operand<f32>,
      }], SDNodeXForm<fpimm, [{
        APFloat InVal = N->getValueAPF();
        uint32_t enc = ARM_AM::getFP32Imm(InVal);
-      return CurDAG->getTargetConstant(enc, MVT::i32);
+      return CurDAG->getTargetConstant(enc, SDLoc(N), MVT::i32);
      }]>> {
    let PrintMethod = "printFPImmOperand";
    let ParserMatchClass = FPImmOperand;
@@ -55,7 +48,7 @@ def vfp_f64imm : Operand<f64>,
      }], SDNodeXForm<fpimm, [{
        APFloat InVal = N->getValueAPF();
        uint32_t enc = ARM_AM::getFP64Imm(InVal);
-      return CurDAG->getTargetConstant(enc, MVT::i32);
+      return CurDAG->getTargetConstant(enc, SDLoc(N), MVT::i32);
      }]>> {
    let PrintMethod = "printFPImmOperand";
    let ParserMatchClass = FPImmOperand;
@@ -99,7 +92,7 @@ def VLDRD : ADI5<0b1101, 0b01, (outs DPR:$Dd), (ins addrmode5:$addr),
  
  def VLDRS : ASI5<0b1101, 0b01, (outs SPR:$Sd), (ins addrmode5:$addr),
                   IIC_fpLoad32, "vldr", "\t$Sd, $addr",
-                 [(set SPR:$Sd, (load addrmode5:$addr))]> {
+                 [(set SPR:$Sd, (alignedload32 addrmode5:$addr))]> {
    // Some single precision VFP instructions may be executed on both NEON and VFP
    // pipelines.
    let D = VFPNeonDomain;
@@ -113,7 +106,7 @@ def VSTRD : ADI5<0b1101, 0b00, (outs), (ins DPR:$Dd, addrmode5:$addr),
  
  def VSTRS : ASI5<0b1101, 0b00, (outs), (ins SPR:$Sd, addrmode5:$addr),
                   IIC_fpStore32, "vstr", "\t$Sd, $addr",
-                 [(store SPR:$Sd, addrmode5:$addr)]> {
+                 [(alignedstore32 SPR:$Sd, addrmode5:$addr)]> {
    // Some single precision VFP instructions may be executed on both NEON and VFP
    // pipelines.
    let D = VFPNeonDomain;
@@ -194,7 +187,7 @@ multiclass vfp_ldst_mult<string asm, bit L_bit,
    }
  }
  
-let neverHasSideEffects = 1 in {
+let hasSideEffects = 0 in {
  
  let mayLoad = 1, hasExtraDefRegAllocReq = 1 in
  defm VLDM : vfp_ldst_mult<"vldm", 1, IIC_fpLoad_m, IIC_fpLoad_mu>;
@@ -202,11 +195,32 @@ defm VLDM : vfp_ldst_mult<"vldm", 1, IIC_fpLoad_m, IIC_fpLoad_mu>;
  let mayStore = 1, hasExtraSrcRegAllocReq = 1 in
  defm VSTM : vfp_ldst_mult<"vstm", 0, IIC_fpStore_m, IIC_fpStore_mu>;
  
-} // neverHasSideEffects
+} // hasSideEffects
  
  def : MnemonicAlias<"vldm", "vldmia">;
  def : MnemonicAlias<"vstm", "vstmia">;
  
+// FLDM/FSTM - Load / Store multiple single / double precision registers for
+// pre-ARMv6 cores.
+// These instructions are deprecated!
+def : VFP2MnemonicAlias<"fldmias", "vldmia">;
+def : VFP2MnemonicAlias<"fldmdbs", "vldmdb">;
+def : VFP2MnemonicAlias<"fldmeas", "vldmdb">;
+def : VFP2MnemonicAlias<"fldmfds", "vldmia">;
+def : VFP2MnemonicAlias<"fldmiad", "vldmia">;
+def : VFP2MnemonicAlias<"fldmdbd", "vldmdb">;
+def : VFP2MnemonicAlias<"fldmead", "vldmdb">;
+def : VFP2MnemonicAlias<"fldmfdd", "vldmia">;
+
+def : VFP2MnemonicAlias<"fstmias", "vstmia">;
+def : VFP2MnemonicAlias<"fstmdbs", "vstmdb">;
+def : VFP2MnemonicAlias<"fstmeas", "vstmia">;
+def : VFP2MnemonicAlias<"fstmfds", "vstmdb">;
+def : VFP2MnemonicAlias<"fstmiad", "vstmia">;
+def : VFP2MnemonicAlias<"fstmdbd", "vstmdb">;
+def : VFP2MnemonicAlias<"fstmead", "vstmia">;
+def : VFP2MnemonicAlias<"fstmfdd", "vstmdb">;
+
  def : InstAlias<"vpush${p} $r", (VSTMDDB_UPD SP, pred:$p, dpr_reglist:$r)>,
                  Requires<[HasVFP2]>;
  def : InstAlias<"vpush${p} $r", (VSTMSDB_UPD SP, pred:$p, spr_reglist:$r)>,
@@ -247,7 +261,7 @@ multiclass vfp_ldstx_mult<string asm, bit L_bit> {
      AXXI4<(outs GPR:$wb), (ins GPR:$Rn, pred:$p, dpr_reglist:$regs, variable_ops),
            IndexModeUpd, !strconcat(asm, "dbx${p}\t$Rn!, $regs"), "$Rn = $wb", []> {
      let Inst{24-23} = 0b10;         // Decrement Before
-    let Inst{21}    = 1;
+    let Inst{21}    = 1;            // Writeback
      let Inst{20}    = L_bit;
    }
  }
@@ -255,6 +269,12 @@ multiclass vfp_ldstx_mult<string asm, bit L_bit> {
  defm FLDM : vfp_ldstx_mult<"fldm", 1>;
  defm FSTM : vfp_ldstx_mult<"fstm", 0>;
  
+def : VFP2MnemonicAlias<"fldmeax", "fldmdbx">;
+def : VFP2MnemonicAlias<"fldmfdx", "fldmiax">;
+
+def : VFP2MnemonicAlias<"fstmeax", "fstmiax">;
+def : VFP2MnemonicAlias<"fstmfdx", "fstmdbx">;
+
  //===----------------------------------------------------------------------===//
  // FP Binary Operations.
  //
@@ -372,8 +392,8 @@ multiclass vmaxmin_inst<string op, bit opc, SDNode SD> {
    }
  }
  
-defm VMAXNM : vmaxmin_inst<"vmaxnm", 0, ARMvmaxnm>;
-defm VMINNM : vmaxmin_inst<"vminnm", 1, ARMvminnm>;
+defm VMAXNM : vmaxmin_inst<"vmaxnm", 0, fmaxnum>;
+defm VMINNM : vmaxmin_inst<"vminnm", 1, fminnum>;
  
  // Match reassociated forms only if not sign dependent rounding.
  def : Pat<(fmul (fneg DPR:$a), (f64 DPR:$b)),
@@ -488,6 +508,8 @@ def VCVTDS  : ASuI<0b11101, 0b11, 0b0111, 0b11, 0,
    let Inst{5}     = Sm{0};
    let Inst{15-12} = Dd{3-0};
    let Inst{22}    = Dd{4};
+
+  let Predicates = [HasVFP2, HasDPVFP];
  }
  
  // Special case encoding: bits 11-8 is 0b1011.
@@ -518,25 +540,23 @@ def VCVTSD  : VFPAI<(outs SPR:$Sd), (ins DPR:$Dm), VFPUnaryFrm,
  // FIXME: Verify encoding after integrated assembler is working.
  def VCVTBHS: ASuI<0b11101, 0b11, 0b0010, 0b01, 0, (outs SPR:$Sd), (ins SPR:$Sm),
                   /* FIXME */ IIC_fpCVTSH, "vcvtb", ".f32.f16\t$Sd, $Sm",
-                 [/* For disassembly only; pattern left blank */]>;
+                 [/* For disassembly only; pattern left blank */]>,
+                 Requires<[HasFP16]>;
  
  def VCVTBSH: ASuI<0b11101, 0b11, 0b0011, 0b01, 0, (outs SPR:$Sd), (ins SPR:$Sm),
                   /* FIXME */ IIC_fpCVTHS, "vcvtb", ".f16.f32\t$Sd, $Sm",
-                 [/* For disassembly only; pattern left blank */]>;
-
-def : Pat<(f32_to_f16 SPR:$a),
-          (i32 (COPY_TO_REGCLASS (VCVTBSH SPR:$a), GPR))>;
-
-def : Pat<(f16_to_f32 GPR:$a),
-          (VCVTBHS (COPY_TO_REGCLASS GPR:$a, SPR))>;
+                 [/* For disassembly only; pattern left blank */]>,
+                 Requires<[HasFP16]>;
  
  def VCVTTHS: ASuI<0b11101, 0b11, 0b0010, 0b11, 0, (outs SPR:$Sd), (ins SPR:$Sm),
                   /* FIXME */ IIC_fpCVTSH, "vcvtt", ".f32.f16\t$Sd, $Sm",
-                 [/* For disassembly only; pattern left blank */]>;
+                 [/* For disassembly only; pattern left blank */]>,
+                 Requires<[HasFP16]>;
  
  def VCVTTSH: ASuI<0b11101, 0b11, 0b0011, 0b11, 0, (outs SPR:$Sd), (ins SPR:$Sm),
                   /* FIXME */ IIC_fpCVTHS, "vcvtt", ".f16.f32\t$Sd, $Sm",
-                 [/* For disassembly only; pattern left blank */]>;
+                 [/* For disassembly only; pattern left blank */]>,
+                 Requires<[HasFP16]>;
  
  def VCVTBHD : ADuI<0b11101, 0b11, 0b0010, 0b01, 0,
                     (outs DPR:$Dd), (ins SPR:$Sm),
@@ -592,26 +612,42 @@ def VCVTTDH : ADuI<0b11101, 0b11, 0b0011, 0b11, 0,
    let Inst{5}     = Dm{4};
  }
  
-multiclass vcvt_inst<string opc, bits<2> rm> {
+def : Pat<(fp_to_f16 SPR:$a),
+          (i32 (COPY_TO_REGCLASS (VCVTBSH SPR:$a), GPR))>;
+
+def : Pat<(fp_to_f16 (f64 DPR:$a)),
+          (i32 (COPY_TO_REGCLASS (VCVTBDH DPR:$a), GPR))>;
+
+def : Pat<(f16_to_fp GPR:$a),
+          (VCVTBHS (COPY_TO_REGCLASS GPR:$a, SPR))>;
+
+def : Pat<(f64 (f16_to_fp GPR:$a)),
+          (VCVTBHD (COPY_TO_REGCLASS GPR:$a, SPR))>;
+
+multiclass vcvt_inst<string opc, bits<2> rm,
+                     SDPatternOperator node = null_frag> {
    let PostEncoderMethod = "", DecoderNamespace = "VFPV8" in {
      def SS : ASuInp<0b11101, 0b11, 0b1100, 0b11, 0,
                      (outs SPR:$Sd), (ins SPR:$Sm),
                      NoItinerary, !strconcat("vcvt", opc, ".s32.f32\t$Sd, $Sm"),
-                    []>, Requires<[HasFPARMv8]> {
+                    []>,
+                    Requires<[HasFPARMv8]> {
        let Inst{17-16} = rm;
      }
  
      def US : ASuInp<0b11101, 0b11, 0b1100, 0b01, 0,
                      (outs SPR:$Sd), (ins SPR:$Sm),
                      NoItinerary, !strconcat("vcvt", opc, ".u32.f32\t$Sd, $Sm"),
-                    []>, Requires<[HasFPARMv8]> {
+                    []>,
+                    Requires<[HasFPARMv8]> {
        let Inst{17-16} = rm;
      }
  
      def SD : ASuInp<0b11101, 0b11, 0b1100, 0b11, 0,
                      (outs SPR:$Sd), (ins DPR:$Dm),
                      NoItinerary, !strconcat("vcvt", opc, ".s32.f64\t$Sd, $Dm"),
-                    []>, Requires<[HasFPARMv8, HasDPVFP]> {
+                    []>,
+                    Requires<[HasFPARMv8, HasDPVFP]> {
        bits<5> Dm;
  
        let Inst{17-16} = rm;
@@ -625,7 +661,8 @@ multiclass vcvt_inst<string opc, bits<2> rm> {
      def UD : ASuInp<0b11101, 0b11, 0b1100, 0b01, 0,
                      (outs SPR:$Sd), (ins DPR:$Dm),
                      NoItinerary, !strconcat("vcvt", opc, ".u32.f64\t$Sd, $Dm"),
-                    []>, Requires<[HasFPARMv8, HasDPVFP]> {
+                    []>,
+                    Requires<[HasFPARMv8, HasDPVFP]> {
        bits<5> Dm;
  
        let Inst{17-16} = rm;
@@ -636,12 +673,33 @@ multiclass vcvt_inst<string opc, bits<2> rm> {
        let Inst{8} = 1;
      }
    }
+
+  let Predicates = [HasFPARMv8] in {
+    def : Pat<(i32 (fp_to_sint (node SPR:$a))),
+              (COPY_TO_REGCLASS
+                (!cast<Instruction>(NAME#"SS") SPR:$a),
+                GPR)>;
+    def : Pat<(i32 (fp_to_uint (node SPR:$a))),
+              (COPY_TO_REGCLASS
+                (!cast<Instruction>(NAME#"US") SPR:$a),
+                GPR)>;
+  }
+  let Predicates = [HasFPARMv8, HasDPVFP] in {
+    def : Pat<(i32 (fp_to_sint (node (f64 DPR:$a)))),
+              (COPY_TO_REGCLASS
+                (!cast<Instruction>(NAME#"SD") DPR:$a),
+                GPR)>;
+    def : Pat<(i32 (fp_to_uint (node (f64 DPR:$a)))),
+              (COPY_TO_REGCLASS
+                (!cast<Instruction>(NAME#"UD") DPR:$a),
+                GPR)>;
+  }
  }
  
-defm VCVTA : vcvt_inst<"a", 0b00>;
+defm VCVTA : vcvt_inst<"a", 0b00, frnd>;
  defm VCVTN : vcvt_inst<"n", 0b01>;
-defm VCVTP : vcvt_inst<"p", 0b10>;
-defm VCVTM : vcvt_inst<"m", 0b11>;
+defm VCVTP : vcvt_inst<"p", 0b10, fceil>;
+defm VCVTM : vcvt_inst<"m", 0b11, ffloor>;
  
  def VNEGD  : ADuI<0b11101, 0b11, 0b0001, 0b01, 0,
                    (outs DPR:$Dd), (ins DPR:$Dm),
@@ -657,18 +715,20 @@ def VNEGS  : ASuIn<0b11101, 0b11, 0b0001, 0b01, 0,
    let D = VFPNeonA8Domain;
  }
  
-multiclass vrint_inst_zrx<string opc, bit op, bit op2> {
+multiclass vrint_inst_zrx<string opc, bit op, bit op2, SDPatternOperator node> {
    def S : ASuI<0b11101, 0b11, 0b0110, 0b11, 0,
                 (outs SPR:$Sd), (ins SPR:$Sm),
                 NoItinerary, !strconcat("vrint", opc), ".f32\t$Sd, $Sm",
-               []>, Requires<[HasFPARMv8]> {
+               [(set (f32 SPR:$Sd), (node (f32 SPR:$Sm)))]>,
+               Requires<[HasFPARMv8]> {
      let Inst{7} = op2;
      let Inst{16} = op;
    }
    def D : ADuI<0b11101, 0b11, 0b0110, 0b11, 0,
                  (outs DPR:$Dd), (ins DPR:$Dm),
                  NoItinerary, !strconcat("vrint", opc), ".f64\t$Dd, $Dm",
-                []>, Requires<[HasFPARMv8, HasDPVFP]> {
+                [(set (f64 DPR:$Dd), (node (f64 DPR:$Dm)))]>,
+                Requires<[HasFPARMv8, HasDPVFP]> {
      let Inst{7} = op2;
      let Inst{16} = op;
    }
@@ -681,22 +741,25 @@ multiclass vrint_inst_zrx<string opc, bit op, bit op2> {
          Requires<[HasFPARMv8,HasDPVFP]>;
  }
  
-defm VRINTZ : vrint_inst_zrx<"z", 0, 1>;
-defm VRINTR : vrint_inst_zrx<"r", 0, 0>;
-defm VRINTX : vrint_inst_zrx<"x", 1, 0>;
+defm VRINTZ : vrint_inst_zrx<"z", 0, 1, ftrunc>;
+defm VRINTR : vrint_inst_zrx<"r", 0, 0, fnearbyint>;
+defm VRINTX : vrint_inst_zrx<"x", 1, 0, frint>;
  
-multiclass vrint_inst_anpm<string opc, bits<2> rm> {
+multiclass vrint_inst_anpm<string opc, bits<2> rm,
+                           SDPatternOperator node = null_frag> {
    let PostEncoderMethod = "", DecoderNamespace = "VFPV8" in {
      def S : ASuInp<0b11101, 0b11, 0b1000, 0b01, 0,
                     (outs SPR:$Sd), (ins SPR:$Sm),
                     NoItinerary, !strconcat("vrint", opc, ".f32\t$Sd, $Sm"),
-                   []>, Requires<[HasFPARMv8]> {
+                   [(set (f32 SPR:$Sd), (node (f32 SPR:$Sm)))]>,
+                   Requires<[HasFPARMv8]> {
        let Inst{17-16} = rm;
      }
      def D : ADuInp<0b11101, 0b11, 0b1000, 0b01, 0,
                     (outs DPR:$Dd), (ins DPR:$Dm),
                     NoItinerary, !strconcat("vrint", opc, ".f64\t$Dd, $Dm"),
-                   []>, Requires<[HasFPARMv8, HasDPVFP]> {
+                   [(set (f64 DPR:$Dd), (node (f64 DPR:$Dm)))]>,
+                   Requires<[HasFPARMv8, HasDPVFP]> {
        let Inst{17-16} = rm;
      }
    }
@@ -709,10 +772,10 @@ multiclass vrint_inst_anpm<string opc, bits<2> rm> {
          Requires<[HasFPARMv8,HasDPVFP]>;
  }
  
-defm VRINTA : vrint_inst_anpm<"a", 0b00>;
+defm VRINTA : vrint_inst_anpm<"a", 0b00, frnd>;
  defm VRINTN : vrint_inst_anpm<"n", 0b01>;
-defm VRINTP : vrint_inst_anpm<"p", 0b10>;
-defm VRINTM : vrint_inst_anpm<"m", 0b11>;
+defm VRINTP : vrint_inst_anpm<"p", 0b10, fceil>;
+defm VRINTM : vrint_inst_anpm<"m", 0b11, ffloor>;
  
  def VSQRTD : ADuI<0b11101, 0b11, 0b0001, 0b11, 0,
                    (outs DPR:$Dd), (ins DPR:$Dm),
@@ -724,7 +787,7 @@ def VSQRTS : ASuI<0b11101, 0b11, 0b0001, 0b11, 0,
                    IIC_fpSQRT32, "vsqrt", ".f32\t$Sd, $Sm",
                    [(set SPR:$Sd, (fsqrt SPR:$Sm))]>;
  
-let neverHasSideEffects = 1 in {
+let hasSideEffects = 0 in {
  def VMOVD  : ADuI<0b11101, 0b11, 0b0000, 0b01, 0,
                    (outs DPR:$Dd), (ins DPR:$Dm),
                    IIC_fpUNA64, "vmov", ".f64\t$Dd, $Dm", []>;
@@ -732,7 +795,7 @@ def VMOVD  : ADuI<0b11101, 0b11, 0b0000, 0b01, 0,
  def VMOVS  : ASuI<0b11101, 0b11, 0b0000, 0b01, 0,
                    (outs SPR:$Sd), (ins SPR:$Sm),
                    IIC_fpUNA32, "vmov", ".f32\t$Sd, $Sm", []>;
-} // neverHasSideEffects
+} // hasSideEffects
  
  //===----------------------------------------------------------------------===//
  // FP <-> GPR Copies.  Int <-> FP Conversions.
@@ -782,7 +845,7 @@ def VMOVSR : AVConv4I<0b11100000, 0b1010,
    let D = VFPNeonDomain;
  }
  
-let neverHasSideEffects = 1 in {
+let hasSideEffects = 0 in {
  def VMOVRRD  : AVConv3I<0b11000101, 0b1011,
                          (outs GPR:$Rt, GPR:$Rt2), (ins DPR:$Dm),
                          IIC_fpMOVDI, "vmov", "\t$Rt, $Rt2, $Dm",
@@ -803,6 +866,11 @@ def VMOVRRD  : AVConv3I<0b11000101, 0b1011,
    // Some single precision VFP instructions may be executed on both NEON and VFP
    // pipelines.
    let D = VFPNeonDomain;
+
+  // This instruction is equivalent to
+  // $Rt = EXTRACT_SUBREG $Dm, ssub_0
+  // $Rt2 = EXTRACT_SUBREG $Dm, ssub_1
+  let isExtractSubreg = 1;
  }
  
  def VMOVRRS  : AVConv3I<0b11000101, 0b1010,
@@ -826,7 +894,7 @@ def VMOVRRS  : AVConv3I<0b11000101, 0b1010,
    let D = VFPNeonDomain;
    let DecoderMethod = "DecodeVMOVRRS";
  }
-} // neverHasSideEffects
+} // hasSideEffects
  
  // FMDHR: GPR -> SPR
  // FMDLR: GPR -> SPR
@@ -851,9 +919,29 @@ def VMOVDRR : AVConv5I<0b11000100, 0b1011,
    // Some single precision VFP instructions may be executed on both NEON and VFP
    // pipelines.
    let D = VFPNeonDomain;
-}
  
-let neverHasSideEffects = 1 in
+  // This instruction is equivalent to
+  // $Dm = REG_SEQUENCE $Rt, ssub_0, $Rt2, ssub_1
+  let isRegSequence = 1;
+}
+
+// Hoist an fabs or a fneg of a value coming from integer registers
+// and do the fabs/fneg on the integer value. This is never a lose
+// and could enable the conversion to float to be removed completely.
+def : Pat<(fabs (arm_fmdrr GPR:$Rl, GPR:$Rh)),
+          (VMOVDRR GPR:$Rl, (BFC GPR:$Rh, (i32 0x7FFFFFFF)))>,
+      Requires<[IsARM, HasV6T2]>;
+def : Pat<(fabs (arm_fmdrr GPR:$Rl, GPR:$Rh)),
+          (VMOVDRR GPR:$Rl, (t2BFC GPR:$Rh, (i32 0x7FFFFFFF)))>,
+      Requires<[IsThumb2, HasV6T2]>;
+def : Pat<(fneg (arm_fmdrr GPR:$Rl, GPR:$Rh)),
+          (VMOVDRR GPR:$Rl, (EORri GPR:$Rh, (i32 0x80000000)))>,
+      Requires<[IsARM]>;
+def : Pat<(fneg (arm_fmdrr GPR:$Rl, GPR:$Rh)),
+          (VMOVDRR GPR:$Rl, (t2EORri GPR:$Rh, (i32 0x80000000)))>,
+      Requires<[IsThumb2]>;
+
+let hasSideEffects = 0 in
  def VMOVSRR : AVConv5I<0b11000100, 0b1010,
                       (outs SPR:$dst1, SPR:$dst2), (ins GPR:$src1, GPR:$src2),
                  IIC_fpMOVID, "vmov", "\t$dst1, $dst2, $src1, $src2",
@@ -926,14 +1014,22 @@ class AVConv1InSs_Encode<bits<5> opcod1, bits<2> opcod2, bits<4> opcod3,
  def VSITOD : AVConv1IDs_Encode<0b11101, 0b11, 0b1000, 0b1011,
                                 (outs DPR:$Dd), (ins SPR:$Sm),
                                 IIC_fpCVTID, "vcvt", ".f64.s32\t$Dd, $Sm",
-                               [(set DPR:$Dd, (f64 (arm_sitof SPR:$Sm)))]> {
+                               []> {
    let Inst{7} = 1; // s32
  }
  
+let Predicates=[HasVFP2, HasDPVFP] in {
+  def : VFPPat<(f64 (sint_to_fp GPR:$a)),
+               (VSITOD (COPY_TO_REGCLASS GPR:$a, SPR))>;
+
+  def : VFPPat<(f64 (sint_to_fp (i32 (alignedload32 addrmode5:$a)))),
+               (VSITOD (VLDRS addrmode5:$a))>;
+}
+
  def VSITOS : AVConv1InSs_Encode<0b11101, 0b11, 0b1000, 0b1010,
                                  (outs SPR:$Sd),(ins SPR:$Sm),
                                  IIC_fpCVTIS, "vcvt", ".f32.s32\t$Sd, $Sm",
-                                [(set SPR:$Sd, (arm_sitof SPR:$Sm))]> {
+                                []> {
    let Inst{7} = 1; // s32
  
    // Some single precision VFP instructions may be executed on both NEON and
@@ -941,17 +1037,31 @@ def VSITOS : AVConv1InSs_Encode<0b11101, 0b11, 0b1000, 0b1010,
    let D = VFPNeonA8Domain;
  }
  
+def : VFPNoNEONPat<(f32 (sint_to_fp GPR:$a)),
+                   (VSITOS (COPY_TO_REGCLASS GPR:$a, SPR))>;
+
+def : VFPNoNEONPat<(f32 (sint_to_fp (i32 (alignedload32 addrmode5:$a)))),
+                   (VSITOS (VLDRS addrmode5:$a))>;
+
  def VUITOD : AVConv1IDs_Encode<0b11101, 0b11, 0b1000, 0b1011,
                                 (outs DPR:$Dd), (ins SPR:$Sm),
                                 IIC_fpCVTID, "vcvt", ".f64.u32\t$Dd, $Sm",
-                               [(set DPR:$Dd, (f64 (arm_uitof SPR:$Sm)))]> {
+                               []> {
    let Inst{7} = 0; // u32
  }
  
+let Predicates=[HasVFP2, HasDPVFP] in {
+  def : VFPPat<(f64 (uint_to_fp GPR:$a)),
+               (VUITOD (COPY_TO_REGCLASS GPR:$a, SPR))>;
+
+  def : VFPPat<(f64 (uint_to_fp (i32 (alignedload32 addrmode5:$a)))),
+               (VUITOD (VLDRS addrmode5:$a))>;
+}
+
  def VUITOS : AVConv1InSs_Encode<0b11101, 0b11, 0b1000, 0b1010,
                                  (outs SPR:$Sd), (ins SPR:$Sm),
                                  IIC_fpCVTIS, "vcvt", ".f32.u32\t$Sd, $Sm",
-                                [(set SPR:$Sd, (arm_uitof SPR:$Sm))]> {
+                                []> {
    let Inst{7} = 0; // u32
  
    // Some single precision VFP instructions may be executed on both NEON and
@@ -959,6 +1069,12 @@ def VUITOS : AVConv1InSs_Encode<0b11101, 0b11, 0b1000, 0b1010,
    let D = VFPNeonA8Domain;
  }
  
+def : VFPNoNEONPat<(f32 (uint_to_fp GPR:$a)),
+                   (VUITOS (COPY_TO_REGCLASS GPR:$a, SPR))>;
+
+def : VFPNoNEONPat<(f32 (uint_to_fp (i32 (alignedload32 addrmode5:$a)))),
+                   (VUITOS (VLDRS addrmode5:$a))>;
+
  // FP -> Int:
  
  class AVConv1IsD_Encode<bits<5> opcod1, bits<2> opcod2, bits<4> opcod3,
@@ -1001,14 +1117,22 @@ class AVConv1InsS_Encode<bits<5> opcod1, bits<2> opcod2, bits<4> opcod3,
  def VTOSIZD : AVConv1IsD_Encode<0b11101, 0b11, 0b1101, 0b1011,
                                  (outs SPR:$Sd), (ins DPR:$Dm),
                                  IIC_fpCVTDI, "vcvt", ".s32.f64\t$Sd, $Dm",
-                                [(set SPR:$Sd, (arm_ftosi (f64 DPR:$Dm)))]> {
+                                []> {
    let Inst{7} = 1; // Z bit
  }
  
+let Predicates=[HasVFP2, HasDPVFP] in {
+  def : VFPPat<(i32 (fp_to_sint (f64 DPR:$a))),
+               (COPY_TO_REGCLASS (VTOSIZD DPR:$a), GPR)>;
+
+  def : VFPPat<(alignedstore32 (i32 (fp_to_sint (f64 DPR:$a))), addrmode5:$ptr),
+               (VSTRS (VTOSIZD DPR:$a), addrmode5:$ptr)>;
+}
+
  def VTOSIZS : AVConv1InsS_Encode<0b11101, 0b11, 0b1101, 0b1010,
                                   (outs SPR:$Sd), (ins SPR:$Sm),
                                   IIC_fpCVTSI, "vcvt", ".s32.f32\t$Sd, $Sm",
-                                 [(set SPR:$Sd, (arm_ftosi SPR:$Sm))]> {
+                                 []> {
    let Inst{7} = 1; // Z bit
  
    // Some single precision VFP instructions may be executed on both NEON and
@@ -1016,17 +1140,32 @@ def VTOSIZS : AVConv1InsS_Encode<0b11101, 0b11, 0b1101, 0b1010,
    let D = VFPNeonA8Domain;
  }
  
+def : VFPNoNEONPat<(i32 (fp_to_sint SPR:$a)),
+                   (COPY_TO_REGCLASS (VTOSIZS SPR:$a), GPR)>;
+
+def : VFPNoNEONPat<(alignedstore32 (i32 (fp_to_sint (f32 SPR:$a))),
+                                   addrmode5:$ptr),
+                   (VSTRS (VTOSIZS SPR:$a), addrmode5:$ptr)>;
+
  def VTOUIZD : AVConv1IsD_Encode<0b11101, 0b11, 0b1100, 0b1011,
                                 (outs SPR:$Sd), (ins DPR:$Dm),
                                 IIC_fpCVTDI, "vcvt", ".u32.f64\t$Sd, $Dm",
-                               [(set SPR:$Sd, (arm_ftoui (f64 DPR:$Dm)))]> {
+                               []> {
    let Inst{7} = 1; // Z bit
  }
  
+let Predicates=[HasVFP2, HasDPVFP] in {
+  def : VFPPat<(i32 (fp_to_uint (f64 DPR:$a))),
+               (COPY_TO_REGCLASS (VTOUIZD DPR:$a), GPR)>;
+
+  def : VFPPat<(alignedstore32 (i32 (fp_to_uint (f64 DPR:$a))), addrmode5:$ptr),
+               (VSTRS (VTOUIZD DPR:$a), addrmode5:$ptr)>;
+}
+
  def VTOUIZS : AVConv1InsS_Encode<0b11101, 0b11, 0b1100, 0b1010,
                                   (outs SPR:$Sd), (ins SPR:$Sm),
                                   IIC_fpCVTSI, "vcvt", ".u32.f32\t$Sd, $Sm",
-                                 [(set SPR:$Sd, (arm_ftoui SPR:$Sm))]> {
+                                 []> {
    let Inst{7} = 1; // Z bit
  
    // Some single precision VFP instructions may be executed on both NEON and
@@ -1034,6 +1173,13 @@ def VTOUIZS : AVConv1InsS_Encode<0b11101, 0b11, 0b1100, 0b1010,
    let D = VFPNeonA8Domain;
  }
  
+def : VFPNoNEONPat<(i32 (fp_to_uint SPR:$a)),
+                   (COPY_TO_REGCLASS (VTOUIZS SPR:$a), GPR)>;
+
+def : VFPNoNEONPat<(alignedstore32 (i32 (fp_to_uint (f32 SPR:$a))),
+                                   addrmode5:$ptr),
+                  (VSTRS (VTOUIZS SPR:$a), addrmode5:$ptr)>;
+
  // And the Z bit '0' variants, i.e. use the rounding mode specified by FPSCR.
  let Uses = [FPSCR] in {
  // FIXME: Verify encoding after integrated assembler is working.
@@ -1489,7 +1635,7 @@ def : Pat<(fneg (f32 (fma SPR:$Sn, (fneg SPR:$Sm), SPR:$Sdin))),
  // FP Conditional moves.
  //
  
-let neverHasSideEffects = 1 in {
+let hasSideEffects = 0 in {
  def VMOVDcc  : PseudoInst<(outs DPR:$Dd), (ins DPR:$Dn, DPR:$Dm, cmovpred:$p),
                      IIC_fpUNA64,
                      [(set (f64 DPR:$Dd),
@@ -1501,7 +1647,7 @@ def VMOVScc  : PseudoInst<(outs SPR:$Sd), (ins SPR:$Sn, SPR:$Sm, cmovpred:$p),
                      [(set (f32 SPR:$Sd),
                            (ARMcmov SPR:$Sn, SPR:$Sm, cmovpred:$p))]>,
                 RegConstraint<"$Sn = $Sd">, Requires<[HasVFP2]>;
-} // neverHasSideEffects
+} // hasSideEffects
  
  //===----------------------------------------------------------------------===//
  // Move from VFP System Register to ARM core register.
@@ -1735,3 +1881,14 @@ def : VFP2InstAlias<"vmov${p}.f64 $Dn, $Rt, $Rt2",
  // VMOVD does.
  def : VFP2InstAlias<"vmov${p} $Sd, $Sm",
                      (VMOVS SPR:$Sd, SPR:$Sm, pred:$p)>;
+
+// FCONSTD/FCONSTS alias for vmov.f64/vmov.f32
+// These aliases provide added functionality over vmov.f instructions by
+// allowing users to write assembly containing encoded floating point constants
+// (e.g. #0x70 vs #1.0).  Without these alises there is no way for the
+// assembler to accept encoded fp constants (but the equivalent fp-literal is
+// accepted directly by vmovf).
+def : VFP3InstAlias<"fconstd${p} $Dd, $val",
+                    (FCONSTD DPR:$Dd, vfp_f64imm:$val, pred:$p)>;
+def : VFP3InstAlias<"fconsts${p} $Sd, $val",
+                    (FCONSTS SPR:$Sd, vfp_f32imm:$val, pred:$p)>;