[X86][SSE] pslldq/psrldq shuffle mask decodes
[oota-llvm.git] / test / CodeGen / X86 / vector-shuffle-128-v8.ll
1 ; RUN: llc < %s -mtriple=x86_64-unknown-unknown -mcpu=x86-64 -x86-experimental-vector-shuffle-lowering | FileCheck %s --check-prefix=ALL --check-prefix=SSE --check-prefix=SSE2
2 ; RUN: llc < %s -mtriple=x86_64-unknown-unknown -mcpu=x86-64 -mattr=+ssse3 -x86-experimental-vector-shuffle-lowering | FileCheck %s --check-prefix=ALL --check-prefix=SSE --check-prefix=SSSE3
3 ; RUN: llc < %s -mtriple=x86_64-unknown-unknown -mcpu=x86-64 -mattr=+sse4.1 -x86-experimental-vector-shuffle-lowering | FileCheck %s --check-prefix=ALL --check-prefix=SSE --check-prefix=SSE41
4 ; RUN: llc < %s -mtriple=x86_64-unknown-unknown -mcpu=x86-64 -mattr=+avx -x86-experimental-vector-shuffle-lowering | FileCheck %s --check-prefix=ALL --check-prefix=AVX --check-prefix=AVX1
5 ; RUN: llc < %s -mtriple=x86_64-unknown-unknown -mcpu=x86-64 -mattr=+avx2 -x86-experimental-vector-shuffle-lowering | FileCheck %s --check-prefix=ALL --check-prefix=AVX --check-prefix=AVX2
6
7 target datalayout = "e-m:e-i64:64-f80:128-n8:16:32:64-S128"
8 target triple = "x86_64-unknown-unknown"
9
10 define <8 x i16> @shuffle_v8i16_01012323(<8 x i16> %a, <8 x i16> %b) {
11 ; SSE-LABEL: shuffle_v8i16_01012323:
12 ; SSE:       # BB#0:
13 ; SSE-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,0,1,1]
14 ; SSE-NEXT:    retq
15 ;
16 ; AVX-LABEL: shuffle_v8i16_01012323:
17 ; AVX:       # BB#0:
18 ; AVX-NEXT:    vpshufd {{.*#+}} xmm0 = xmm0[0,0,1,1]
19 ; AVX-NEXT:    retq
20   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 0, i32 1, i32 0, i32 1, i32 2, i32 3, i32 2, i32 3>
21   ret <8 x i16> %shuffle
22 }
23 define <8 x i16> @shuffle_v8i16_67452301(<8 x i16> %a, <8 x i16> %b) {
24 ; SSE-LABEL: shuffle_v8i16_67452301:
25 ; SSE:       # BB#0:
26 ; SSE-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[3,2,1,0]
27 ; SSE-NEXT:    retq
28 ;
29 ; AVX-LABEL: shuffle_v8i16_67452301:
30 ; AVX:       # BB#0:
31 ; AVX-NEXT:    vpshufd {{.*#+}} xmm0 = xmm0[3,2,1,0]
32 ; AVX-NEXT:    retq
33   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 6, i32 7, i32 4, i32 5, i32 2, i32 3, i32 0, i32 1>
34   ret <8 x i16> %shuffle
35 }
36 define <8 x i16> @shuffle_v8i16_456789AB(<8 x i16> %a, <8 x i16> %b) {
37 ; SSE2-LABEL: shuffle_v8i16_456789AB:
38 ; SSE2:       # BB#0:
39 ; SSE2-NEXT:    shufpd {{.*#+}} xmm0 = xmm0[1],xmm1[0]
40 ; SSE2-NEXT:    retq
41 ;
42 ; SSSE3-LABEL: shuffle_v8i16_456789AB:
43 ; SSSE3:       # BB#0:
44 ; SSSE3-NEXT:    palignr {{.*#+}} xmm1 = xmm0[8,9,10,11,12,13,14,15],xmm1[0,1,2,3,4,5,6,7]
45 ; SSSE3-NEXT:    movdqa %xmm1, %xmm0
46 ; SSSE3-NEXT:    retq
47 ;
48 ; SSE41-LABEL: shuffle_v8i16_456789AB:
49 ; SSE41:       # BB#0:
50 ; SSE41-NEXT:    palignr {{.*#+}} xmm1 = xmm0[8,9,10,11,12,13,14,15],xmm1[0,1,2,3,4,5,6,7]
51 ; SSE41-NEXT:    movdqa %xmm1, %xmm0
52 ; SSE41-NEXT:    retq
53 ;
54 ; AVX-LABEL: shuffle_v8i16_456789AB:
55 ; AVX:       # BB#0:
56 ; AVX-NEXT:    vpalignr {{.*#+}} xmm0 = xmm0[8,9,10,11,12,13,14,15],xmm1[0,1,2,3,4,5,6,7]
57 ; AVX-NEXT:    retq
58   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 4, i32 5, i32 6, i32 7, i32 8, i32 9, i32 10, i32 11>
59   ret <8 x i16> %shuffle
60 }
61
62 define <8 x i16> @shuffle_v8i16_00000000(<8 x i16> %a, <8 x i16> %b) {
63 ; SSE2-LABEL: shuffle_v8i16_00000000:
64 ; SSE2:       # BB#0:
65 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,1,0,3]
66 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,0,0,0,4,5,6,7]
67 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,4,4,4,4]
68 ; SSE2-NEXT:    retq
69 ;
70 ; SSSE3-LABEL: shuffle_v8i16_00000000:
71 ; SSSE3:       # BB#0:
72 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,0,1,0,1,0,1,0,1,0,1,0,1,0,1]
73 ; SSSE3-NEXT:    retq
74 ;
75 ; SSE41-LABEL: shuffle_v8i16_00000000:
76 ; SSE41:       # BB#0:
77 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,0,1,0,1,0,1,0,1,0,1,0,1,0,1]
78 ; SSE41-NEXT:    retq
79 ;
80 ; AVX1-LABEL: shuffle_v8i16_00000000:
81 ; AVX1:       # BB#0:
82 ; AVX1-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[0,1,0,1,0,1,0,1,0,1,0,1,0,1,0,1]
83 ; AVX1-NEXT:    retq
84 ;
85 ; AVX2-LABEL: shuffle_v8i16_00000000:
86 ; AVX2:       # BB#0:
87 ; AVX2-NEXT:    vpbroadcastw %xmm0, %xmm0
88 ; AVX2-NEXT:    retq
89   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 0, i32 0, i32 0, i32 0, i32 0, i32 0, i32 0, i32 0>
90   ret <8 x i16> %shuffle
91 }
92 define <8 x i16> @shuffle_v8i16_00004444(<8 x i16> %a, <8 x i16> %b) {
93 ; SSE-LABEL: shuffle_v8i16_00004444:
94 ; SSE:       # BB#0:
95 ; SSE-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,0,0,0,4,5,6,7]
96 ; SSE-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,4,4,4,4]
97 ; SSE-NEXT:    retq
98 ;
99 ; AVX-LABEL: shuffle_v8i16_00004444:
100 ; AVX:       # BB#0:
101 ; AVX-NEXT:    vpshuflw {{.*#+}} xmm0 = xmm0[0,0,0,0,4,5,6,7]
102 ; AVX-NEXT:    vpshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,4,4,4,4]
103 ; AVX-NEXT:    retq
104   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 0, i32 0, i32 0, i32 0, i32 4, i32 4, i32 4, i32 4>
105   ret <8 x i16> %shuffle
106 }
107 define <8 x i16> @shuffle_v8i16_u0u1u2u3(<8 x i16> %a, <8 x i16> %b) {
108 ; SSE-LABEL: shuffle_v8i16_u0u1u2u3:
109 ; SSE:       # BB#0:
110 ; SSE-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0,0,1,1,2,2,3,3]
111 ; SSE-NEXT:    retq
112 ;
113 ; AVX-LABEL: shuffle_v8i16_u0u1u2u3:
114 ; AVX:       # BB#0:
115 ; AVX-NEXT:    vpunpcklwd {{.*#+}} xmm0 = xmm0[0,0,1,1,2,2,3,3]
116 ; AVX-NEXT:    retq
117   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 undef, i32 0, i32 undef, i32 1, i32 undef, i32 2, i32 undef, i32 3>
118   ret <8 x i16> %shuffle
119 }
120 define <8 x i16> @shuffle_v8i16_u4u5u6u7(<8 x i16> %a, <8 x i16> %b) {
121 ; SSE-LABEL: shuffle_v8i16_u4u5u6u7:
122 ; SSE:       # BB#0:
123 ; SSE-NEXT:    punpckhwd {{.*#+}} xmm0 = xmm0[4,4,5,5,6,6,7,7]
124 ; SSE-NEXT:    retq
125 ;
126 ; AVX-LABEL: shuffle_v8i16_u4u5u6u7:
127 ; AVX:       # BB#0:
128 ; AVX-NEXT:    vpunpckhwd {{.*#+}} xmm0 = xmm0[4,4,5,5,6,6,7,7]
129 ; AVX-NEXT:    retq
130   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 undef, i32 4, i32 undef, i32 5, i32 undef, i32 6, i32 undef, i32 7>
131   ret <8 x i16> %shuffle
132 }
133 define <8 x i16> @shuffle_v8i16_31206745(<8 x i16> %a, <8 x i16> %b) {
134 ; SSE-LABEL: shuffle_v8i16_31206745:
135 ; SSE:       # BB#0:
136 ; SSE-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[3,1,2,0,4,5,6,7]
137 ; SSE-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,1,3,2]
138 ; SSE-NEXT:    retq
139 ;
140 ; AVX-LABEL: shuffle_v8i16_31206745:
141 ; AVX:       # BB#0:
142 ; AVX-NEXT:    vpshuflw {{.*#+}} xmm0 = xmm0[3,1,2,0,4,5,6,7]
143 ; AVX-NEXT:    vpshufd {{.*#+}} xmm0 = xmm0[0,1,3,2]
144 ; AVX-NEXT:    retq
145   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 3, i32 1, i32 2, i32 0, i32 6, i32 7, i32 4, i32 5>
146   ret <8 x i16> %shuffle
147 }
148 define <8 x i16> @shuffle_v8i16_44440000(<8 x i16> %a, <8 x i16> %b) {
149 ; SSE2-LABEL: shuffle_v8i16_44440000:
150 ; SSE2:       # BB#0:
151 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[2,1,0,3]
152 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,0,0,0,4,5,6,7]
153 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,4,4,4,4]
154 ; SSE2-NEXT:    retq
155 ;
156 ; SSSE3-LABEL: shuffle_v8i16_44440000:
157 ; SSSE3:       # BB#0:
158 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[8,9,8,9,8,9,8,9,0,1,0,1,0,1,0,1]
159 ; SSSE3-NEXT:    retq
160 ;
161 ; SSE41-LABEL: shuffle_v8i16_44440000:
162 ; SSE41:       # BB#0:
163 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[8,9,8,9,8,9,8,9,0,1,0,1,0,1,0,1]
164 ; SSE41-NEXT:    retq
165 ;
166 ; AVX-LABEL: shuffle_v8i16_44440000:
167 ; AVX:       # BB#0:
168 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[8,9,8,9,8,9,8,9,0,1,0,1,0,1,0,1]
169 ; AVX-NEXT:    retq
170   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 4, i32 4, i32 4, i32 4, i32 0, i32 0, i32 0, i32 0>
171   ret <8 x i16> %shuffle
172 }
173 define <8 x i16> @shuffle_v8i16_23016745(<8 x i16> %a, <8 x i16> %b) {
174 ; SSE-LABEL: shuffle_v8i16_23016745:
175 ; SSE:       # BB#0:
176 ; SSE-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[1,0,3,2]
177 ; SSE-NEXT:    retq
178 ;
179 ; AVX-LABEL: shuffle_v8i16_23016745:
180 ; AVX:       # BB#0:
181 ; AVX-NEXT:    vpshufd {{.*#+}} xmm0 = xmm0[1,0,3,2]
182 ; AVX-NEXT:    retq
183   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 2, i32 3, i32 0, i32 1, i32 6, i32 7, i32 4, i32 5>
184   ret <8 x i16> %shuffle
185 }
186 define <8 x i16> @shuffle_v8i16_23026745(<8 x i16> %a, <8 x i16> %b) {
187 ; SSE-LABEL: shuffle_v8i16_23026745:
188 ; SSE:       # BB#0:
189 ; SSE-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[2,3,0,2,4,5,6,7]
190 ; SSE-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,1,3,2]
191 ; SSE-NEXT:    retq
192 ;
193 ; AVX-LABEL: shuffle_v8i16_23026745:
194 ; AVX:       # BB#0:
195 ; AVX-NEXT:    vpshuflw {{.*#+}} xmm0 = xmm0[2,3,0,2,4,5,6,7]
196 ; AVX-NEXT:    vpshufd {{.*#+}} xmm0 = xmm0[0,1,3,2]
197 ; AVX-NEXT:    retq
198   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 2, i32 3, i32 0, i32 2, i32 6, i32 7, i32 4, i32 5>
199   ret <8 x i16> %shuffle
200 }
201 define <8 x i16> @shuffle_v8i16_23016747(<8 x i16> %a, <8 x i16> %b) {
202 ; SSE-LABEL: shuffle_v8i16_23016747:
203 ; SSE:       # BB#0:
204 ; SSE-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[1,0,2,3]
205 ; SSE-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,6,7,4,7]
206 ; SSE-NEXT:    retq
207 ;
208 ; AVX-LABEL: shuffle_v8i16_23016747:
209 ; AVX:       # BB#0:
210 ; AVX-NEXT:    vpshufd {{.*#+}} xmm0 = xmm0[1,0,2,3]
211 ; AVX-NEXT:    vpshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,6,7,4,7]
212 ; AVX-NEXT:    retq
213   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 2, i32 3, i32 0, i32 1, i32 6, i32 7, i32 4, i32 7>
214   ret <8 x i16> %shuffle
215 }
216 define <8 x i16> @shuffle_v8i16_75643120(<8 x i16> %a, <8 x i16> %b) {
217 ; SSE2-LABEL: shuffle_v8i16_75643120:
218 ; SSE2:       # BB#0:
219 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[2,3,0,1]
220 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[3,1,2,0,4,5,6,7]
221 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,7,5,6,4]
222 ; SSE2-NEXT:    retq
223 ;
224 ; SSSE3-LABEL: shuffle_v8i16_75643120:
225 ; SSSE3:       # BB#0:
226 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[14,15,10,11,12,13,8,9,6,7,2,3,4,5,0,1]
227 ; SSSE3-NEXT:    retq
228 ;
229 ; SSE41-LABEL: shuffle_v8i16_75643120:
230 ; SSE41:       # BB#0:
231 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[14,15,10,11,12,13,8,9,6,7,2,3,4,5,0,1]
232 ; SSE41-NEXT:    retq
233 ;
234 ; AVX-LABEL: shuffle_v8i16_75643120:
235 ; AVX:       # BB#0:
236 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[14,15,10,11,12,13,8,9,6,7,2,3,4,5,0,1]
237 ; AVX-NEXT:    retq
238   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 7, i32 5, i32 6, i32 4, i32 3, i32 1, i32 2, i32 0>
239   ret <8 x i16> %shuffle
240 }
241
242 define <8 x i16> @shuffle_v8i16_10545410(<8 x i16> %a, <8 x i16> %b) {
243 ; SSE2-LABEL: shuffle_v8i16_10545410:
244 ; SSE2:       # BB#0:
245 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,2,0]
246 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[1,0,3,2,4,5,6,7]
247 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,5,4,7,6]
248 ; SSE2-NEXT:    retq
249 ;
250 ; SSSE3-LABEL: shuffle_v8i16_10545410:
251 ; SSSE3:       # BB#0:
252 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[2,3,0,1,10,11,8,9,10,11,8,9,2,3,0,1]
253 ; SSSE3-NEXT:    retq
254 ;
255 ; SSE41-LABEL: shuffle_v8i16_10545410:
256 ; SSE41:       # BB#0:
257 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[2,3,0,1,10,11,8,9,10,11,8,9,2,3,0,1]
258 ; SSE41-NEXT:    retq
259 ;
260 ; AVX-LABEL: shuffle_v8i16_10545410:
261 ; AVX:       # BB#0:
262 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[2,3,0,1,10,11,8,9,10,11,8,9,2,3,0,1]
263 ; AVX-NEXT:    retq
264   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 1, i32 0, i32 5, i32 4, i32 5, i32 4, i32 1, i32 0>
265   ret <8 x i16> %shuffle
266 }
267 define <8 x i16> @shuffle_v8i16_54105410(<8 x i16> %a, <8 x i16> %b) {
268 ; SSE2-LABEL: shuffle_v8i16_54105410:
269 ; SSE2:       # BB#0:
270 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,2,0]
271 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[3,2,1,0,4,5,6,7]
272 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,5,4,7,6]
273 ; SSE2-NEXT:    retq
274 ;
275 ; SSSE3-LABEL: shuffle_v8i16_54105410:
276 ; SSSE3:       # BB#0:
277 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[10,11,8,9,2,3,0,1,10,11,8,9,2,3,0,1]
278 ; SSSE3-NEXT:    retq
279 ;
280 ; SSE41-LABEL: shuffle_v8i16_54105410:
281 ; SSE41:       # BB#0:
282 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[10,11,8,9,2,3,0,1,10,11,8,9,2,3,0,1]
283 ; SSE41-NEXT:    retq
284 ;
285 ; AVX-LABEL: shuffle_v8i16_54105410:
286 ; AVX:       # BB#0:
287 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[10,11,8,9,2,3,0,1,10,11,8,9,2,3,0,1]
288 ; AVX-NEXT:    retq
289   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 5, i32 4, i32 1, i32 0, i32 5, i32 4, i32 1, i32 0>
290   ret <8 x i16> %shuffle
291 }
292 define <8 x i16> @shuffle_v8i16_54101054(<8 x i16> %a, <8 x i16> %b) {
293 ; SSE2-LABEL: shuffle_v8i16_54101054:
294 ; SSE2:       # BB#0:
295 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,2,0]
296 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[3,2,1,0,4,5,6,7]
297 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,7,6,5,4]
298 ; SSE2-NEXT:    retq
299 ;
300 ; SSSE3-LABEL: shuffle_v8i16_54101054:
301 ; SSSE3:       # BB#0:
302 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[10,11,8,9,2,3,0,1,2,3,0,1,10,11,8,9]
303 ; SSSE3-NEXT:    retq
304 ;
305 ; SSE41-LABEL: shuffle_v8i16_54101054:
306 ; SSE41:       # BB#0:
307 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[10,11,8,9,2,3,0,1,2,3,0,1,10,11,8,9]
308 ; SSE41-NEXT:    retq
309 ;
310 ; AVX-LABEL: shuffle_v8i16_54101054:
311 ; AVX:       # BB#0:
312 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[10,11,8,9,2,3,0,1,2,3,0,1,10,11,8,9]
313 ; AVX-NEXT:    retq
314   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 5, i32 4, i32 1, i32 0, i32 1, i32 0, i32 5, i32 4>
315   ret <8 x i16> %shuffle
316 }
317 define <8 x i16> @shuffle_v8i16_04400440(<8 x i16> %a, <8 x i16> %b) {
318 ; SSE2-LABEL: shuffle_v8i16_04400440:
319 ; SSE2:       # BB#0:
320 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,2,0]
321 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,2,2,0,4,5,6,7]
322 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,6,4,4,6]
323 ; SSE2-NEXT:    retq
324 ;
325 ; SSSE3-LABEL: shuffle_v8i16_04400440:
326 ; SSSE3:       # BB#0:
327 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,8,9,8,9,0,1,0,1,8,9,8,9,0,1]
328 ; SSSE3-NEXT:    retq
329 ;
330 ; SSE41-LABEL: shuffle_v8i16_04400440:
331 ; SSE41:       # BB#0:
332 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,8,9,8,9,0,1,0,1,8,9,8,9,0,1]
333 ; SSE41-NEXT:    retq
334 ;
335 ; AVX-LABEL: shuffle_v8i16_04400440:
336 ; AVX:       # BB#0:
337 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[0,1,8,9,8,9,0,1,0,1,8,9,8,9,0,1]
338 ; AVX-NEXT:    retq
339   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 0, i32 4, i32 4, i32 0, i32 0, i32 4, i32 4, i32 0>
340   ret <8 x i16> %shuffle
341 }
342 define <8 x i16> @shuffle_v8i16_40044004(<8 x i16> %a, <8 x i16> %b) {
343 ; SSE2-LABEL: shuffle_v8i16_40044004:
344 ; SSE2:       # BB#0:
345 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,2,0]
346 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[2,0,0,2,4,5,6,7]
347 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,4,6,6,4]
348 ; SSE2-NEXT:    retq
349 ;
350 ; SSSE3-LABEL: shuffle_v8i16_40044004:
351 ; SSSE3:       # BB#0:
352 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[8,9,0,1,0,1,8,9,8,9,0,1,0,1,8,9]
353 ; SSSE3-NEXT:    retq
354 ;
355 ; SSE41-LABEL: shuffle_v8i16_40044004:
356 ; SSE41:       # BB#0:
357 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[8,9,0,1,0,1,8,9,8,9,0,1,0,1,8,9]
358 ; SSE41-NEXT:    retq
359 ;
360 ; AVX-LABEL: shuffle_v8i16_40044004:
361 ; AVX:       # BB#0:
362 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[8,9,0,1,0,1,8,9,8,9,0,1,0,1,8,9]
363 ; AVX-NEXT:    retq
364   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 4, i32 0, i32 0, i32 4, i32 4, i32 0, i32 0, i32 4>
365   ret <8 x i16> %shuffle
366 }
367
368 define <8 x i16> @shuffle_v8i16_26405173(<8 x i16> %a, <8 x i16> %b) {
369 ; SSE2-LABEL: shuffle_v8i16_26405173:
370 ; SSE2:       # BB#0:
371 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,2,1,3,4,5,6,7]
372 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,7,5,6,4]
373 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,3,2,1]
374 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[1,2,3,0,4,5,6,7]
375 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,5,6,4,7]
376 ; SSE2-NEXT:    retq
377 ;
378 ; SSSE3-LABEL: shuffle_v8i16_26405173:
379 ; SSSE3:       # BB#0:
380 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[4,5,12,13,8,9,0,1,10,11,2,3,14,15,6,7]
381 ; SSSE3-NEXT:    retq
382 ;
383 ; SSE41-LABEL: shuffle_v8i16_26405173:
384 ; SSE41:       # BB#0:
385 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[4,5,12,13,8,9,0,1,10,11,2,3,14,15,6,7]
386 ; SSE41-NEXT:    retq
387 ;
388 ; AVX-LABEL: shuffle_v8i16_26405173:
389 ; AVX:       # BB#0:
390 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[4,5,12,13,8,9,0,1,10,11,2,3,14,15,6,7]
391 ; AVX-NEXT:    retq
392   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 2, i32 6, i32 4, i32 0, i32 5, i32 1, i32 7, i32 3>
393   ret <8 x i16> %shuffle
394 }
395 define <8 x i16> @shuffle_v8i16_20645173(<8 x i16> %a, <8 x i16> %b) {
396 ; SSE2-LABEL: shuffle_v8i16_20645173:
397 ; SSE2:       # BB#0:
398 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,2,1,3,4,5,6,7]
399 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,7,5,6,4]
400 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,3,2,1]
401 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[1,0,2,3,4,5,6,7]
402 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,5,6,4,7]
403 ; SSE2-NEXT:    retq
404 ;
405 ; SSSE3-LABEL: shuffle_v8i16_20645173:
406 ; SSSE3:       # BB#0:
407 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[4,5,0,1,12,13,8,9,10,11,2,3,14,15,6,7]
408 ; SSSE3-NEXT:    retq
409 ;
410 ; SSE41-LABEL: shuffle_v8i16_20645173:
411 ; SSE41:       # BB#0:
412 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[4,5,0,1,12,13,8,9,10,11,2,3,14,15,6,7]
413 ; SSE41-NEXT:    retq
414 ;
415 ; AVX-LABEL: shuffle_v8i16_20645173:
416 ; AVX:       # BB#0:
417 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[4,5,0,1,12,13,8,9,10,11,2,3,14,15,6,7]
418 ; AVX-NEXT:    retq
419   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 2, i32 0, i32 6, i32 4, i32 5, i32 1, i32 7, i32 3>
420   ret <8 x i16> %shuffle
421 }
422 define <8 x i16> @shuffle_v8i16_26401375(<8 x i16> %a, <8 x i16> %b) {
423 ; SSE2-LABEL: shuffle_v8i16_26401375:
424 ; SSE2:       # BB#0:
425 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,2,1,3,4,5,6,7]
426 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,7,5,6,4]
427 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,3,1,2]
428 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[1,2,3,0,4,5,6,7]
429 ; SSE2-NEXT:    retq
430 ;
431 ; SSSE3-LABEL: shuffle_v8i16_26401375:
432 ; SSSE3:       # BB#0:
433 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[4,5,12,13,8,9,0,1,2,3,6,7,14,15,10,11]
434 ; SSSE3-NEXT:    retq
435 ;
436 ; SSE41-LABEL: shuffle_v8i16_26401375:
437 ; SSE41:       # BB#0:
438 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[4,5,12,13,8,9,0,1,2,3,6,7,14,15,10,11]
439 ; SSE41-NEXT:    retq
440 ;
441 ; AVX-LABEL: shuffle_v8i16_26401375:
442 ; AVX:       # BB#0:
443 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[4,5,12,13,8,9,0,1,2,3,6,7,14,15,10,11]
444 ; AVX-NEXT:    retq
445   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 2, i32 6, i32 4, i32 0, i32 1, i32 3, i32 7, i32 5>
446   ret <8 x i16> %shuffle
447 }
448
449 define <8 x i16> @shuffle_v8i16_66751643(<8 x i16> %a, <8 x i16> %b) {
450 ; SSE2-LABEL: shuffle_v8i16_66751643:
451 ; SSE2:       # BB#0:
452 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[3,1,2,3,4,5,6,7]
453 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,4,6,5,7]
454 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[2,3,2,0]
455 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[1,1,3,2,4,5,6,7]
456 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,7,5,4,6]
457 ; SSE2-NEXT:    retq
458 ;
459 ; SSSE3-LABEL: shuffle_v8i16_66751643:
460 ; SSSE3:       # BB#0:
461 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[12,13,12,13,14,15,10,11,2,3,12,13,8,9,6,7]
462 ; SSSE3-NEXT:    retq
463 ;
464 ; SSE41-LABEL: shuffle_v8i16_66751643:
465 ; SSE41:       # BB#0:
466 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[12,13,12,13,14,15,10,11,2,3,12,13,8,9,6,7]
467 ; SSE41-NEXT:    retq
468 ;
469 ; AVX-LABEL: shuffle_v8i16_66751643:
470 ; AVX:       # BB#0:
471 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[12,13,12,13,14,15,10,11,2,3,12,13,8,9,6,7]
472 ; AVX-NEXT:    retq
473   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 6, i32 6, i32 7, i32 5, i32 1, i32 6, i32 4, i32 3>
474   ret <8 x i16> %shuffle
475 }
476
477 define <8 x i16> @shuffle_v8i16_60514754(<8 x i16> %a, <8 x i16> %b) {
478 ; SSE2-LABEL: shuffle_v8i16_60514754:
479 ; SSE2:       # BB#0:
480 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,6,5,4,7]
481 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,2,3]
482 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[2,0,3,1,4,5,6,7]
483 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,6,7,5,6]
484 ; SSE2-NEXT:    retq
485 ;
486 ; SSSE3-LABEL: shuffle_v8i16_60514754:
487 ; SSSE3:       # BB#0:
488 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[12,13,0,1,10,11,2,3,8,9,14,15,10,11,8,9]
489 ; SSSE3-NEXT:    retq
490 ;
491 ; SSE41-LABEL: shuffle_v8i16_60514754:
492 ; SSE41:       # BB#0:
493 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[12,13,0,1,10,11,2,3,8,9,14,15,10,11,8,9]
494 ; SSE41-NEXT:    retq
495 ;
496 ; AVX-LABEL: shuffle_v8i16_60514754:
497 ; AVX:       # BB#0:
498 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[12,13,0,1,10,11,2,3,8,9,14,15,10,11,8,9]
499 ; AVX-NEXT:    retq
500   %shuffle = shufflevector <8 x i16> %a, <8 x i16> undef, <8 x i32> <i32 6, i32 0, i32 5, i32 1, i32 4, i32 7, i32 5, i32 4>
501   ret <8 x i16> %shuffle
502 }
503
504 define <8 x i16> @shuffle_v8i16_00444444(<8 x i16> %a, <8 x i16> %b) {
505 ; SSE2-LABEL: shuffle_v8i16_00444444:
506 ; SSE2:       # BB#0:
507 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,2,3]
508 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,0,2,2,4,5,6,7]
509 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,4,4,4,4]
510 ; SSE2-NEXT:    retq
511 ;
512 ; SSSE3-LABEL: shuffle_v8i16_00444444:
513 ; SSSE3:       # BB#0:
514 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,0,1,8,9,8,9,8,9,8,9,8,9,8,9]
515 ; SSSE3-NEXT:    retq
516 ;
517 ; SSE41-LABEL: shuffle_v8i16_00444444:
518 ; SSE41:       # BB#0:
519 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,0,1,8,9,8,9,8,9,8,9,8,9,8,9]
520 ; SSE41-NEXT:    retq
521 ;
522 ; AVX-LABEL: shuffle_v8i16_00444444:
523 ; AVX:       # BB#0:
524 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[0,1,0,1,8,9,8,9,8,9,8,9,8,9,8,9]
525 ; AVX-NEXT:    retq
526   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 0, i32 0, i32 4, i32 4, i32 4, i32 4, i32 4, i32 4>
527   ret <8 x i16> %shuffle
528 }
529 define <8 x i16> @shuffle_v8i16_44004444(<8 x i16> %a, <8 x i16> %b) {
530 ; SSE2-LABEL: shuffle_v8i16_44004444:
531 ; SSE2:       # BB#0:
532 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,2,3]
533 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[2,2,0,0,4,5,6,7]
534 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,4,4,4,4]
535 ; SSE2-NEXT:    retq
536 ;
537 ; SSSE3-LABEL: shuffle_v8i16_44004444:
538 ; SSSE3:       # BB#0:
539 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[8,9,8,9,0,1,0,1,8,9,8,9,8,9,8,9]
540 ; SSSE3-NEXT:    retq
541 ;
542 ; SSE41-LABEL: shuffle_v8i16_44004444:
543 ; SSE41:       # BB#0:
544 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[8,9,8,9,0,1,0,1,8,9,8,9,8,9,8,9]
545 ; SSE41-NEXT:    retq
546 ;
547 ; AVX-LABEL: shuffle_v8i16_44004444:
548 ; AVX:       # BB#0:
549 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[8,9,8,9,0,1,0,1,8,9,8,9,8,9,8,9]
550 ; AVX-NEXT:    retq
551   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 4, i32 4, i32 0, i32 0, i32 4, i32 4, i32 4, i32 4>
552   ret <8 x i16> %shuffle
553 }
554 define <8 x i16> @shuffle_v8i16_04404444(<8 x i16> %a, <8 x i16> %b) {
555 ; SSE2-LABEL: shuffle_v8i16_04404444:
556 ; SSE2:       # BB#0:
557 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,2,3]
558 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,2,2,0,4,5,6,7]
559 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,4,4,4,4]
560 ; SSE2-NEXT:    retq
561 ;
562 ; SSSE3-LABEL: shuffle_v8i16_04404444:
563 ; SSSE3:       # BB#0:
564 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,8,9,8,9,0,1,8,9,8,9,8,9,8,9]
565 ; SSSE3-NEXT:    retq
566 ;
567 ; SSE41-LABEL: shuffle_v8i16_04404444:
568 ; SSE41:       # BB#0:
569 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,8,9,8,9,0,1,8,9,8,9,8,9,8,9]
570 ; SSE41-NEXT:    retq
571 ;
572 ; AVX-LABEL: shuffle_v8i16_04404444:
573 ; AVX:       # BB#0:
574 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[0,1,8,9,8,9,0,1,8,9,8,9,8,9,8,9]
575 ; AVX-NEXT:    retq
576   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 0, i32 4, i32 4, i32 0, i32 4, i32 4, i32 4, i32 4>
577   ret <8 x i16> %shuffle
578 }
579 define <8 x i16> @shuffle_v8i16_04400000(<8 x i16> %a, <8 x i16> %b) {
580 ; SSE2-LABEL: shuffle_v8i16_04400000:
581 ; SSE2:       # BB#0:
582 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,0,3]
583 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,2,2,0,4,5,6,7]
584 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,4,4,4,4]
585 ; SSE2-NEXT:    retq
586 ;
587 ; SSSE3-LABEL: shuffle_v8i16_04400000:
588 ; SSSE3:       # BB#0:
589 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,8,9,8,9,0,1,0,1,0,1,0,1,0,1]
590 ; SSSE3-NEXT:    retq
591 ;
592 ; SSE41-LABEL: shuffle_v8i16_04400000:
593 ; SSE41:       # BB#0:
594 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,8,9,8,9,0,1,0,1,0,1,0,1,0,1]
595 ; SSE41-NEXT:    retq
596 ;
597 ; AVX-LABEL: shuffle_v8i16_04400000:
598 ; AVX:       # BB#0:
599 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[0,1,8,9,8,9,0,1,0,1,0,1,0,1,0,1]
600 ; AVX-NEXT:    retq
601   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 0, i32 4, i32 4, i32 0, i32 0, i32 0, i32 0, i32 0>
602   ret <8 x i16> %shuffle
603 }
604 define <8 x i16> @shuffle_v8i16_04404567(<8 x i16> %a, <8 x i16> %b) {
605 ; SSE-LABEL: shuffle_v8i16_04404567:
606 ; SSE:       # BB#0:
607 ; SSE-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,2,3]
608 ; SSE-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,2,2,0,4,5,6,7]
609 ; SSE-NEXT:    retq
610 ;
611 ; AVX-LABEL: shuffle_v8i16_04404567:
612 ; AVX:       # BB#0:
613 ; AVX-NEXT:    vpshufd {{.*#+}} xmm0 = xmm0[0,2,2,3]
614 ; AVX-NEXT:    vpshuflw {{.*#+}} xmm0 = xmm0[0,2,2,0,4,5,6,7]
615 ; AVX-NEXT:    retq
616   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 0, i32 4, i32 4, i32 0, i32 4, i32 5, i32 6, i32 7>
617   ret <8 x i16> %shuffle
618 }
619
620 define <8 x i16> @shuffle_v8i16_0X444444(<8 x i16> %a, <8 x i16> %b) {
621 ; SSE2-LABEL: shuffle_v8i16_0X444444:
622 ; SSE2:       # BB#0:
623 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,2,3]
624 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,1,2,2,4,5,6,7]
625 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,4,4,4,4]
626 ; SSE2-NEXT:    retq
627 ;
628 ; SSSE3-LABEL: shuffle_v8i16_0X444444:
629 ; SSSE3:       # BB#0:
630 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,2,3,8,9,8,9,8,9,8,9,8,9,8,9]
631 ; SSSE3-NEXT:    retq
632 ;
633 ; SSE41-LABEL: shuffle_v8i16_0X444444:
634 ; SSE41:       # BB#0:
635 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,2,3,8,9,8,9,8,9,8,9,8,9,8,9]
636 ; SSE41-NEXT:    retq
637 ;
638 ; AVX-LABEL: shuffle_v8i16_0X444444:
639 ; AVX:       # BB#0:
640 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[0,1,2,3,8,9,8,9,8,9,8,9,8,9,8,9]
641 ; AVX-NEXT:    retq
642   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 0, i32 undef, i32 4, i32 4, i32 4, i32 4, i32 4, i32 4>
643   ret <8 x i16> %shuffle
644 }
645 define <8 x i16> @shuffle_v8i16_44X04444(<8 x i16> %a, <8 x i16> %b) {
646 ; SSE2-LABEL: shuffle_v8i16_44X04444:
647 ; SSE2:       # BB#0:
648 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,2,3]
649 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[2,2,2,0,4,5,6,7]
650 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,4,4,4,4]
651 ; SSE2-NEXT:    retq
652 ;
653 ; SSSE3-LABEL: shuffle_v8i16_44X04444:
654 ; SSSE3:       # BB#0:
655 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[8,9,8,9,8,9,0,1,8,9,8,9,8,9,8,9]
656 ; SSSE3-NEXT:    retq
657 ;
658 ; SSE41-LABEL: shuffle_v8i16_44X04444:
659 ; SSE41:       # BB#0:
660 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[8,9,8,9,8,9,0,1,8,9,8,9,8,9,8,9]
661 ; SSE41-NEXT:    retq
662 ;
663 ; AVX-LABEL: shuffle_v8i16_44X04444:
664 ; AVX:       # BB#0:
665 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[8,9,8,9,8,9,0,1,8,9,8,9,8,9,8,9]
666 ; AVX-NEXT:    retq
667   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 4, i32 4, i32 undef, i32 0, i32 4, i32 4, i32 4, i32 4>
668   ret <8 x i16> %shuffle
669 }
670 define <8 x i16> @shuffle_v8i16_X4404444(<8 x i16> %a, <8 x i16> %b) {
671 ; SSE2-LABEL: shuffle_v8i16_X4404444:
672 ; SSE2:       # BB#0:
673 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,2,3]
674 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,2,2,0,4,5,6,7]
675 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,4,4,4,4]
676 ; SSE2-NEXT:    retq
677 ;
678 ; SSSE3-LABEL: shuffle_v8i16_X4404444:
679 ; SSSE3:       # BB#0:
680 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,8,9,8,9,0,1,8,9,8,9,8,9,8,9]
681 ; SSSE3-NEXT:    retq
682 ;
683 ; SSE41-LABEL: shuffle_v8i16_X4404444:
684 ; SSE41:       # BB#0:
685 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,8,9,8,9,0,1,8,9,8,9,8,9,8,9]
686 ; SSE41-NEXT:    retq
687 ;
688 ; AVX-LABEL: shuffle_v8i16_X4404444:
689 ; AVX:       # BB#0:
690 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[0,1,8,9,8,9,0,1,8,9,8,9,8,9,8,9]
691 ; AVX-NEXT:    retq
692   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 undef, i32 4, i32 4, i32 0, i32 4, i32 4, i32 4, i32 4>
693   ret <8 x i16> %shuffle
694 }
695
696 define <8 x i16> @shuffle_v8i16_0127XXXX(<8 x i16> %a, <8 x i16> %b) {
697 ; SSE2-LABEL: shuffle_v8i16_0127XXXX:
698 ; SSE2:       # BB#0:
699 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,1,3]
700 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,4,7,6,7]
701 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,2,3]
702 ; SSE2-NEXT:    retq
703 ;
704 ; SSSE3-LABEL: shuffle_v8i16_0127XXXX:
705 ; SSSE3:       # BB#0:
706 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,2,3,4,5,14,15,4,5,14,15,12,13,14,15]
707 ; SSSE3-NEXT:    retq
708 ;
709 ; SSE41-LABEL: shuffle_v8i16_0127XXXX:
710 ; SSE41:       # BB#0:
711 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,2,3,4,5,14,15,4,5,14,15,12,13,14,15]
712 ; SSE41-NEXT:    retq
713 ;
714 ; AVX-LABEL: shuffle_v8i16_0127XXXX:
715 ; AVX:       # BB#0:
716 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[0,1,2,3,4,5,14,15,4,5,14,15,12,13,14,15]
717 ; AVX-NEXT:    retq
718   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 0, i32 1, i32 2, i32 7, i32 undef, i32 undef, i32 undef, i32 undef>
719   ret <8 x i16> %shuffle
720 }
721
722 define <8 x i16> @shuffle_v8i16_XXXX4563(<8 x i16> %a, <8 x i16> %b) {
723 ; SSE2-LABEL: shuffle_v8i16_XXXX4563:
724 ; SSE2:       # BB#0:
725 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[3,1,2,0]
726 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,3,2,3,4,5,6,7]
727 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,1,2,0]
728 ; SSE2-NEXT:    retq
729 ;
730 ; SSSE3-LABEL: shuffle_v8i16_XXXX4563:
731 ; SSSE3:       # BB#0:
732 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[12,13,6,7,4,5,6,7,8,9,10,11,12,13,6,7]
733 ; SSSE3-NEXT:    retq
734 ;
735 ; SSE41-LABEL: shuffle_v8i16_XXXX4563:
736 ; SSE41:       # BB#0:
737 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[12,13,6,7,4,5,6,7,8,9,10,11,12,13,6,7]
738 ; SSE41-NEXT:    retq
739 ;
740 ; AVX-LABEL: shuffle_v8i16_XXXX4563:
741 ; AVX:       # BB#0:
742 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[12,13,6,7,4,5,6,7,8,9,10,11,12,13,6,7]
743 ; AVX-NEXT:    retq
744   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 undef, i32 undef, i32 undef, i32 undef, i32 4, i32 5, i32 6, i32 3>
745   ret <8 x i16> %shuffle
746 }
747
748 define <8 x i16> @shuffle_v8i16_4563XXXX(<8 x i16> %a, <8 x i16> %b) {
749 ; SSE2-LABEL: shuffle_v8i16_4563XXXX:
750 ; SSE2:       # BB#0:
751 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[3,1,2,0]
752 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,3,2,3,4,5,6,7]
753 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[2,0,2,3]
754 ; SSE2-NEXT:    retq
755 ;
756 ; SSSE3-LABEL: shuffle_v8i16_4563XXXX:
757 ; SSSE3:       # BB#0:
758 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[8,9,10,11,12,13,6,7,8,9,10,11,0,1,2,3]
759 ; SSSE3-NEXT:    retq
760 ;
761 ; SSE41-LABEL: shuffle_v8i16_4563XXXX:
762 ; SSE41:       # BB#0:
763 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[8,9,10,11,12,13,6,7,8,9,10,11,0,1,2,3]
764 ; SSE41-NEXT:    retq
765 ;
766 ; AVX-LABEL: shuffle_v8i16_4563XXXX:
767 ; AVX:       # BB#0:
768 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[8,9,10,11,12,13,6,7,8,9,10,11,0,1,2,3]
769 ; AVX-NEXT:    retq
770   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 4, i32 5, i32 6, i32 3, i32 undef, i32 undef, i32 undef, i32 undef>
771   ret <8 x i16> %shuffle
772 }
773
774 define <8 x i16> @shuffle_v8i16_01274563(<8 x i16> %a, <8 x i16> %b) {
775 ; SSE2-LABEL: shuffle_v8i16_01274563:
776 ; SSE2:       # BB#0:
777 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,1,3]
778 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,6,5,4,7]
779 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,3,1,2]
780 ; SSE2-NEXT:    retq
781 ;
782 ; SSSE3-LABEL: shuffle_v8i16_01274563:
783 ; SSSE3:       # BB#0:
784 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,2,3,4,5,14,15,8,9,10,11,12,13,6,7]
785 ; SSSE3-NEXT:    retq
786 ;
787 ; SSE41-LABEL: shuffle_v8i16_01274563:
788 ; SSE41:       # BB#0:
789 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,2,3,4,5,14,15,8,9,10,11,12,13,6,7]
790 ; SSE41-NEXT:    retq
791 ;
792 ; AVX-LABEL: shuffle_v8i16_01274563:
793 ; AVX:       # BB#0:
794 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[0,1,2,3,4,5,14,15,8,9,10,11,12,13,6,7]
795 ; AVX-NEXT:    retq
796   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 0, i32 1, i32 2, i32 7, i32 4, i32 5, i32 6, i32 3>
797   ret <8 x i16> %shuffle
798 }
799
800 define <8 x i16> @shuffle_v8i16_45630127(<8 x i16> %a, <8 x i16> %b) {
801 ; SSE2-LABEL: shuffle_v8i16_45630127:
802 ; SSE2:       # BB#0:
803 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[3,1,2,0]
804 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,3,2,1,4,5,6,7]
805 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[2,0,3,1]
806 ; SSE2-NEXT:    retq
807 ;
808 ; SSSE3-LABEL: shuffle_v8i16_45630127:
809 ; SSSE3:       # BB#0:
810 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[8,9,10,11,12,13,6,7,0,1,2,3,4,5,14,15]
811 ; SSSE3-NEXT:    retq
812 ;
813 ; SSE41-LABEL: shuffle_v8i16_45630127:
814 ; SSE41:       # BB#0:
815 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[8,9,10,11,12,13,6,7,0,1,2,3,4,5,14,15]
816 ; SSE41-NEXT:    retq
817 ;
818 ; AVX-LABEL: shuffle_v8i16_45630127:
819 ; AVX:       # BB#0:
820 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[8,9,10,11,12,13,6,7,0,1,2,3,4,5,14,15]
821 ; AVX-NEXT:    retq
822   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 4, i32 5, i32 6, i32 3, i32 0, i32 1, i32 2, i32 7>
823   ret <8 x i16> %shuffle
824 }
825
826 define <8 x i16> @shuffle_v8i16_37102735(<8 x i16> %a, <8 x i16> %b) {
827 ; SSE2-LABEL: shuffle_v8i16_37102735:
828 ; SSE2:       # BB#0:
829 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,4,6,5,7]
830 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,1,3]
831 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,7,5,6,4]
832 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,2,3]
833 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[3,2,1,0,4,5,6,7]
834 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,7,4,5,6]
835 ; SSE2-NEXT:    retq
836 ;
837 ; SSSE3-LABEL: shuffle_v8i16_37102735:
838 ; SSSE3:       # BB#0:
839 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[6,7,14,15,2,3,0,1,4,5,14,15,6,7,10,11]
840 ; SSSE3-NEXT:    retq
841 ;
842 ; SSE41-LABEL: shuffle_v8i16_37102735:
843 ; SSE41:       # BB#0:
844 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[6,7,14,15,2,3,0,1,4,5,14,15,6,7,10,11]
845 ; SSE41-NEXT:    retq
846 ;
847 ; AVX-LABEL: shuffle_v8i16_37102735:
848 ; AVX:       # BB#0:
849 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[6,7,14,15,2,3,0,1,4,5,14,15,6,7,10,11]
850 ; AVX-NEXT:    retq
851   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 3, i32 7, i32 1, i32 0, i32 2, i32 7, i32 3, i32 5>
852   ret <8 x i16> %shuffle
853 }
854
855 define <8 x i16> @shuffle_v8i16_08192a3b(<8 x i16> %a, <8 x i16> %b) {
856 ; SSE-LABEL: shuffle_v8i16_08192a3b:
857 ; SSE:       # BB#0:
858 ; SSE-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
859 ; SSE-NEXT:    retq
860 ;
861 ; AVX-LABEL: shuffle_v8i16_08192a3b:
862 ; AVX:       # BB#0:
863 ; AVX-NEXT:    vpunpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
864 ; AVX-NEXT:    retq
865   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 0, i32 8, i32 1, i32 9, i32 2, i32 10, i32 3, i32 11>
866   ret <8 x i16> %shuffle
867 }
868
869 define <8 x i16> @shuffle_v8i16_0c1d2e3f(<8 x i16> %a, <8 x i16> %b) {
870 ; SSE-LABEL: shuffle_v8i16_0c1d2e3f:
871 ; SSE:       # BB#0:
872 ; SSE-NEXT:    pshufd {{.*#+}} xmm1 = xmm1[2,3,0,1]
873 ; SSE-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
874 ; SSE-NEXT:    retq
875 ;
876 ; AVX-LABEL: shuffle_v8i16_0c1d2e3f:
877 ; AVX:       # BB#0:
878 ; AVX-NEXT:    vpshufd {{.*#+}} xmm1 = xmm1[2,3,0,1]
879 ; AVX-NEXT:    vpunpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
880 ; AVX-NEXT:    retq
881   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 0, i32 12, i32 1, i32 13, i32 2, i32 14, i32 3, i32 15>
882   ret <8 x i16> %shuffle
883 }
884
885 define <8 x i16> @shuffle_v8i16_4c5d6e7f(<8 x i16> %a, <8 x i16> %b) {
886 ; SSE-LABEL: shuffle_v8i16_4c5d6e7f:
887 ; SSE:       # BB#0:
888 ; SSE-NEXT:    pshufd {{.*#+}} xmm1 = xmm1[2,3,0,1]
889 ; SSE-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[2,3,0,1]
890 ; SSE-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
891 ; SSE-NEXT:    retq
892 ;
893 ; AVX-LABEL: shuffle_v8i16_4c5d6e7f:
894 ; AVX:       # BB#0:
895 ; AVX-NEXT:    vpshufd {{.*#+}} xmm1 = xmm1[2,3,0,1]
896 ; AVX-NEXT:    vpshufd {{.*#+}} xmm0 = xmm0[2,3,0,1]
897 ; AVX-NEXT:    vpunpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
898 ; AVX-NEXT:    retq
899   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 4, i32 12, i32 5, i32 13, i32 6, i32 14, i32 7, i32 15>
900   ret <8 x i16> %shuffle
901 }
902
903 define <8 x i16> @shuffle_v8i16_48596a7b(<8 x i16> %a, <8 x i16> %b) {
904 ; SSE-LABEL: shuffle_v8i16_48596a7b:
905 ; SSE:       # BB#0:
906 ; SSE-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[2,3,0,1]
907 ; SSE-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
908 ; SSE-NEXT:    retq
909 ;
910 ; AVX-LABEL: shuffle_v8i16_48596a7b:
911 ; AVX:       # BB#0:
912 ; AVX-NEXT:    vpshufd {{.*#+}} xmm0 = xmm0[2,3,0,1]
913 ; AVX-NEXT:    vpunpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
914 ; AVX-NEXT:    retq
915   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 4, i32 8, i32 5, i32 9, i32 6, i32 10, i32 7, i32 11>
916   ret <8 x i16> %shuffle
917 }
918
919 define <8 x i16> @shuffle_v8i16_08196e7f(<8 x i16> %a, <8 x i16> %b) {
920 ; SSE-LABEL: shuffle_v8i16_08196e7f:
921 ; SSE:       # BB#0:
922 ; SSE-NEXT:    pshufd {{.*#+}} xmm1 = xmm1[0,3,2,3]
923 ; SSE-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,3,2,3]
924 ; SSE-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
925 ; SSE-NEXT:    retq
926 ;
927 ; AVX-LABEL: shuffle_v8i16_08196e7f:
928 ; AVX:       # BB#0:
929 ; AVX-NEXT:    vpshufd {{.*#+}} xmm1 = xmm1[0,3,2,3]
930 ; AVX-NEXT:    vpshufd {{.*#+}} xmm0 = xmm0[0,3,2,3]
931 ; AVX-NEXT:    vpunpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
932 ; AVX-NEXT:    retq
933   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 0, i32 8, i32 1, i32 9, i32 6, i32 14, i32 7, i32 15>
934   ret <8 x i16> %shuffle
935 }
936
937 define <8 x i16> @shuffle_v8i16_0c1d6879(<8 x i16> %a, <8 x i16> %b) {
938 ; SSE-LABEL: shuffle_v8i16_0c1d6879:
939 ; SSE:       # BB#0:
940 ; SSE-NEXT:    pshufd {{.*#+}} xmm1 = xmm1[2,0,2,3]
941 ; SSE-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,3,2,3]
942 ; SSE-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
943 ; SSE-NEXT:    retq
944 ;
945 ; AVX-LABEL: shuffle_v8i16_0c1d6879:
946 ; AVX:       # BB#0:
947 ; AVX-NEXT:    vpshufd {{.*#+}} xmm1 = xmm1[2,0,2,3]
948 ; AVX-NEXT:    vpshufd {{.*#+}} xmm0 = xmm0[0,3,2,3]
949 ; AVX-NEXT:    vpunpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
950 ; AVX-NEXT:    retq
951   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 0, i32 12, i32 1, i32 13, i32 6, i32 8, i32 7, i32 9>
952   ret <8 x i16> %shuffle
953 }
954
955 define <8 x i16> @shuffle_v8i16_109832ba(<8 x i16> %a, <8 x i16> %b) {
956 ; SSE-LABEL: shuffle_v8i16_109832ba:
957 ; SSE:       # BB#0:
958 ; SSE-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
959 ; SSE-NEXT:    pshuflw {{.*#+}} xmm1 = xmm0[2,0,3,1,4,5,6,7]
960 ; SSE-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[2,3,2,3]
961 ; SSE-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[2,0,3,1,4,5,6,7]
962 ; SSE-NEXT:    punpcklqdq {{.*#+}} xmm1 = xmm1[0],xmm0[0]
963 ; SSE-NEXT:    movdqa %xmm1, %xmm0
964 ; SSE-NEXT:    retq
965 ;
966 ; AVX-LABEL: shuffle_v8i16_109832ba:
967 ; AVX:       # BB#0:
968 ; AVX-NEXT:    vpunpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
969 ; AVX-NEXT:    vpshuflw {{.*#+}} xmm1 = xmm0[2,0,3,1,4,5,6,7]
970 ; AVX-NEXT:    vpshufd {{.*#+}} xmm0 = xmm0[2,3,2,3]
971 ; AVX-NEXT:    vpshuflw {{.*#+}} xmm0 = xmm0[2,0,3,1,4,5,6,7]
972 ; AVX-NEXT:    vpunpcklqdq {{.*#+}} xmm0 = xmm1[0],xmm0[0]
973 ; AVX-NEXT:    retq
974   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 1, i32 0, i32 9, i32 8, i32 3, i32 2, i32 11, i32 10>
975   ret <8 x i16> %shuffle
976 }
977
978 define <8 x i16> @shuffle_v8i16_8091a2b3(<8 x i16> %a, <8 x i16> %b) {
979 ; SSE-LABEL: shuffle_v8i16_8091a2b3:
980 ; SSE:       # BB#0:
981 ; SSE-NEXT:    punpcklwd {{.*#+}} xmm1 = xmm1[0],xmm0[0],xmm1[1],xmm0[1],xmm1[2],xmm0[2],xmm1[3],xmm0[3]
982 ; SSE-NEXT:    movdqa %xmm1, %xmm0
983 ; SSE-NEXT:    retq
984 ;
985 ; AVX-LABEL: shuffle_v8i16_8091a2b3:
986 ; AVX:       # BB#0:
987 ; AVX-NEXT:    vpunpcklwd {{.*#+}} xmm0 = xmm1[0],xmm0[0],xmm1[1],xmm0[1],xmm1[2],xmm0[2],xmm1[3],xmm0[3]
988 ; AVX-NEXT:    retq
989   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 8, i32 0, i32 9, i32 1, i32 10, i32 2, i32 11, i32 3>
990   ret <8 x i16> %shuffle
991 }
992 define <8 x i16> @shuffle_v8i16_c4d5e6f7(<8 x i16> %a, <8 x i16> %b) {
993 ; SSE-LABEL: shuffle_v8i16_c4d5e6f7:
994 ; SSE:       # BB#0:
995 ; SSE-NEXT:    pshufd {{.*#+}} xmm2 = xmm0[2,3,0,1]
996 ; SSE-NEXT:    pshufd {{.*#+}} xmm0 = xmm1[2,3,0,1]
997 ; SSE-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm2[0],xmm0[1],xmm2[1],xmm0[2],xmm2[2],xmm0[3],xmm2[3]
998 ; SSE-NEXT:    retq
999 ;
1000 ; AVX-LABEL: shuffle_v8i16_c4d5e6f7:
1001 ; AVX:       # BB#0:
1002 ; AVX-NEXT:    vpshufd {{.*#+}} xmm0 = xmm0[2,3,0,1]
1003 ; AVX-NEXT:    vpshufd {{.*#+}} xmm1 = xmm1[2,3,0,1]
1004 ; AVX-NEXT:    vpunpcklwd {{.*#+}} xmm0 = xmm1[0],xmm0[0],xmm1[1],xmm0[1],xmm1[2],xmm0[2],xmm1[3],xmm0[3]
1005 ; AVX-NEXT:    retq
1006   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 12, i32 4, i32 13, i32 5, i32 14, i32 6, i32 15, i32 7>
1007   ret <8 x i16> %shuffle
1008 }
1009
1010 define <8 x i16> @shuffle_v8i16_0213cedf(<8 x i16> %a, <8 x i16> %b) {
1011 ; SSE-LABEL: shuffle_v8i16_0213cedf:
1012 ; SSE:       # BB#0:
1013 ; SSE-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,2,1,3,4,5,6,7]
1014 ; SSE-NEXT:    pshufd {{.*#+}} xmm1 = xmm1[2,3,2,3]
1015 ; SSE-NEXT:    pshuflw {{.*#+}} xmm1 = xmm1[0,2,1,3,4,5,6,7]
1016 ; SSE-NEXT:    punpcklqdq {{.*#+}} xmm0 = xmm0[0],xmm1[0]
1017 ; SSE-NEXT:    retq
1018 ;
1019 ; AVX-LABEL: shuffle_v8i16_0213cedf:
1020 ; AVX:       # BB#0:
1021 ; AVX-NEXT:    vpshuflw {{.*#+}} xmm0 = xmm0[0,2,1,3,4,5,6,7]
1022 ; AVX-NEXT:    vpshufd {{.*#+}} xmm1 = xmm1[2,3,2,3]
1023 ; AVX-NEXT:    vpshuflw {{.*#+}} xmm1 = xmm1[0,2,1,3,4,5,6,7]
1024 ; AVX-NEXT:    vpunpcklqdq {{.*#+}} xmm0 = xmm0[0],xmm1[0]
1025 ; AVX-NEXT:    retq
1026   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 0, i32 2, i32 1, i32 3, i32 12, i32 14, i32 13, i32 15>
1027   ret <8 x i16> %shuffle
1028 }
1029
1030 define <8 x i16> @shuffle_v8i16_443aXXXX(<8 x i16> %a, <8 x i16> %b) {
1031 ; SSE2-LABEL: shuffle_v8i16_443aXXXX:
1032 ; SSE2:       # BB#0:
1033 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[2,1,2,3]
1034 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,0,2,3,4,5,6,7]
1035 ; SSE2-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
1036 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,2,2,3,4,5,6,7]
1037 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,6,5,6,7]
1038 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,2,3]
1039 ; SSE2-NEXT:    retq
1040 ;
1041 ; SSSE3-LABEL: shuffle_v8i16_443aXXXX:
1042 ; SSSE3:       # BB#0:
1043 ; SSSE3-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[2,1,2,3]
1044 ; SSSE3-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,0,2,3,4,5,6,7]
1045 ; SSSE3-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
1046 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,4,5,12,13,10,11,12,13,10,11,12,13,14,15]
1047 ; SSSE3-NEXT:    retq
1048 ;
1049 ; SSE41-LABEL: shuffle_v8i16_443aXXXX:
1050 ; SSE41:       # BB#0:
1051 ; SSE41-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[2,1,2,3]
1052 ; SSE41-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,0,2,3,4,5,6,7]
1053 ; SSE41-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
1054 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,4,5,12,13,10,11,12,13,10,11,12,13,14,15]
1055 ; SSE41-NEXT:    retq
1056 ;
1057 ; AVX-LABEL: shuffle_v8i16_443aXXXX:
1058 ; AVX:       # BB#0:
1059 ; AVX-NEXT:    vpshufd {{.*#+}} xmm0 = xmm0[2,1,2,3]
1060 ; AVX-NEXT:    vpshuflw {{.*#+}} xmm0 = xmm0[0,0,2,3,4,5,6,7]
1061 ; AVX-NEXT:    vpunpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
1062 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[0,1,4,5,12,13,10,11,12,13,10,11,12,13,14,15]
1063 ; AVX-NEXT:    retq
1064   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 4, i32 4, i32 3, i32 10, i32 undef, i32 undef, i32 undef, i32 undef>
1065   ret <8 x i16> %shuffle
1066 }
1067
1068 define <8 x i16> @shuffle_v8i16_032dXXXX(<8 x i16> %a, <8 x i16> %b) {
1069 ; SSE2-LABEL: shuffle_v8i16_032dXXXX:
1070 ; SSE2:       # BB#0:
1071 ; SSE2-NEXT:    pshufd {{.*#+}} xmm1 = xmm1[2,3,0,1]
1072 ; SSE2-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
1073 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,3,2,3,4,5,6,7]
1074 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,4,6,6,7]
1075 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,2,3]
1076 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,3,2,1,4,5,6,7]
1077 ; SSE2-NEXT:    retq
1078 ;
1079 ; SSSE3-LABEL: shuffle_v8i16_032dXXXX:
1080 ; SSSE3:       # BB#0:
1081 ; SSSE3-NEXT:    pshufd {{.*#+}} xmm1 = xmm1[2,3,0,1]
1082 ; SSSE3-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
1083 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,12,13,8,9,6,7,8,9,12,13,12,13,14,15]
1084 ; SSSE3-NEXT:    retq
1085 ;
1086 ; SSE41-LABEL: shuffle_v8i16_032dXXXX:
1087 ; SSE41:       # BB#0:
1088 ; SSE41-NEXT:    pshufd {{.*#+}} xmm1 = xmm1[2,3,0,1]
1089 ; SSE41-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
1090 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,12,13,8,9,6,7,8,9,12,13,12,13,14,15]
1091 ; SSE41-NEXT:    retq
1092 ;
1093 ; AVX-LABEL: shuffle_v8i16_032dXXXX:
1094 ; AVX:       # BB#0:
1095 ; AVX-NEXT:    vpshufd {{.*#+}} xmm1 = xmm1[2,3,0,1]
1096 ; AVX-NEXT:    vpunpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
1097 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[0,1,12,13,8,9,6,7,8,9,12,13,12,13,14,15]
1098 ; AVX-NEXT:    retq
1099   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 0, i32 3, i32 2, i32 13, i32 undef, i32 undef, i32 undef, i32 undef>
1100   ret <8 x i16> %shuffle
1101 }
1102 define <8 x i16> @shuffle_v8i16_XXXdXXXX(<8 x i16> %a, <8 x i16> %b) {
1103 ; SSE-LABEL: shuffle_v8i16_XXXdXXXX:
1104 ; SSE:       # BB#0:
1105 ; SSE-NEXT:    pshufd {{.*#+}} xmm0 = xmm1[2,2,3,3]
1106 ; SSE-NEXT:    retq
1107 ;
1108 ; AVX-LABEL: shuffle_v8i16_XXXdXXXX:
1109 ; AVX:       # BB#0:
1110 ; AVX-NEXT:    vpshufd {{.*#+}} xmm0 = xmm1[2,2,3,3]
1111 ; AVX-NEXT:    retq
1112   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 undef, i32 undef, i32 undef, i32 13, i32 undef, i32 undef, i32 undef, i32 undef>
1113   ret <8 x i16> %shuffle
1114 }
1115
1116 define <8 x i16> @shuffle_v8i16_012dXXXX(<8 x i16> %a, <8 x i16> %b) {
1117 ; SSE2-LABEL: shuffle_v8i16_012dXXXX:
1118 ; SSE2:       # BB#0:
1119 ; SSE2-NEXT:    pshufd {{.*#+}} xmm1 = xmm1[2,3,0,1]
1120 ; SSE2-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
1121 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[3,1,2,0]
1122 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,4,6,6,7]
1123 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[2,1,2,3]
1124 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[1,2,0,3,4,5,6,7]
1125 ; SSE2-NEXT:    retq
1126 ;
1127 ; SSSE3-LABEL: shuffle_v8i16_012dXXXX:
1128 ; SSSE3:       # BB#0:
1129 ; SSSE3-NEXT:    pshufd {{.*#+}} xmm1 = xmm1[2,3,0,1]
1130 ; SSSE3-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
1131 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,4,5,8,9,6,7,8,9,0,1,0,1,2,3]
1132 ; SSSE3-NEXT:    retq
1133 ;
1134 ; SSE41-LABEL: shuffle_v8i16_012dXXXX:
1135 ; SSE41:       # BB#0:
1136 ; SSE41-NEXT:    pshufd {{.*#+}} xmm1 = xmm1[2,3,0,1]
1137 ; SSE41-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
1138 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,4,5,8,9,6,7,8,9,0,1,0,1,2,3]
1139 ; SSE41-NEXT:    retq
1140 ;
1141 ; AVX-LABEL: shuffle_v8i16_012dXXXX:
1142 ; AVX:       # BB#0:
1143 ; AVX-NEXT:    vpshufd {{.*#+}} xmm1 = xmm1[2,3,0,1]
1144 ; AVX-NEXT:    vpunpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
1145 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[0,1,4,5,8,9,6,7,8,9,0,1,0,1,2,3]
1146 ; AVX-NEXT:    retq
1147   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 0, i32 1, i32 2, i32 13, i32 undef, i32 undef, i32 undef, i32 undef>
1148   ret <8 x i16> %shuffle
1149 }
1150
1151 define <8 x i16> @shuffle_v8i16_XXXXcde3(<8 x i16> %a, <8 x i16> %b) {
1152 ; SSE2-LABEL: shuffle_v8i16_XXXXcde3:
1153 ; SSE2:       # BB#0:
1154 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,1,0,1]
1155 ; SSE2-NEXT:    punpckhwd {{.*#+}} xmm1 = xmm1[4],xmm0[4],xmm1[5],xmm0[5],xmm1[6],xmm0[6],xmm1[7],xmm0[7]
1156 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm1[0,2,2,3,4,5,6,7]
1157 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,4,7,6,7]
1158 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,1,0,2]
1159 ; SSE2-NEXT:    retq
1160 ;
1161 ; SSSE3-LABEL: shuffle_v8i16_XXXXcde3:
1162 ; SSSE3:       # BB#0:
1163 ; SSSE3-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,1,0,1]
1164 ; SSSE3-NEXT:    punpckhwd {{.*#+}} xmm1 = xmm1[4],xmm0[4],xmm1[5],xmm0[5],xmm1[6],xmm0[6],xmm1[7],xmm0[7]
1165 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm1 = xmm1[0,1,4,5,4,5,6,7,0,1,4,5,8,9,14,15]
1166 ; SSSE3-NEXT:    movdqa %xmm1, %xmm0
1167 ; SSSE3-NEXT:    retq
1168 ;
1169 ; SSE41-LABEL: shuffle_v8i16_XXXXcde3:
1170 ; SSE41:       # BB#0:
1171 ; SSE41-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,1,0,1]
1172 ; SSE41-NEXT:    punpckhwd {{.*#+}} xmm1 = xmm1[4],xmm0[4],xmm1[5],xmm0[5],xmm1[6],xmm0[6],xmm1[7],xmm0[7]
1173 ; SSE41-NEXT:    pshufb {{.*#+}} xmm1 = xmm1[0,1,4,5,4,5,6,7,0,1,4,5,8,9,14,15]
1174 ; SSE41-NEXT:    movdqa %xmm1, %xmm0
1175 ; SSE41-NEXT:    retq
1176 ;
1177 ; AVX1-LABEL: shuffle_v8i16_XXXXcde3:
1178 ; AVX1:       # BB#0:
1179 ; AVX1-NEXT:    vpshufd {{.*#+}} xmm0 = xmm0[0,1,0,1]
1180 ; AVX1-NEXT:    vpunpckhwd {{.*#+}} xmm0 = xmm1[4],xmm0[4],xmm1[5],xmm0[5],xmm1[6],xmm0[6],xmm1[7],xmm0[7]
1181 ; AVX1-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[0,1,4,5,4,5,6,7,0,1,4,5,8,9,14,15]
1182 ; AVX1-NEXT:    retq
1183 ;
1184 ; AVX2-LABEL: shuffle_v8i16_XXXXcde3:
1185 ; AVX2:       # BB#0:
1186 ; AVX2-NEXT:    vpbroadcastq %xmm0, %xmm0
1187 ; AVX2-NEXT:    vpunpckhwd {{.*#+}} xmm0 = xmm1[4],xmm0[4],xmm1[5],xmm0[5],xmm1[6],xmm0[6],xmm1[7],xmm0[7]
1188 ; AVX2-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[0,1,4,5,4,5,6,7,0,1,4,5,8,9,14,15]
1189 ; AVX2-NEXT:    retq
1190   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 undef, i32 undef, i32 undef, i32 undef, i32 12, i32 13, i32 14, i32 3>
1191   ret <8 x i16> %shuffle
1192 }
1193
1194 define <8 x i16> @shuffle_v8i16_cde3XXXX(<8 x i16> %a, <8 x i16> %b) {
1195 ; SSE2-LABEL: shuffle_v8i16_cde3XXXX:
1196 ; SSE2:       # BB#0:
1197 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,1,0,1]
1198 ; SSE2-NEXT:    punpckhwd {{.*#+}} xmm1 = xmm1[4],xmm0[4],xmm1[5],xmm0[5],xmm1[6],xmm0[6],xmm1[7],xmm0[7]
1199 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm1[0,2,2,3,4,5,6,7]
1200 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,4,7,6,7]
1201 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,2,3]
1202 ; SSE2-NEXT:    retq
1203 ;
1204 ; SSSE3-LABEL: shuffle_v8i16_cde3XXXX:
1205 ; SSSE3:       # BB#0:
1206 ; SSSE3-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,1,0,1]
1207 ; SSSE3-NEXT:    punpckhwd {{.*#+}} xmm1 = xmm1[4],xmm0[4],xmm1[5],xmm0[5],xmm1[6],xmm0[6],xmm1[7],xmm0[7]
1208 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm1 = xmm1[0,1,4,5,8,9,14,15,8,9,14,15,12,13,14,15]
1209 ; SSSE3-NEXT:    movdqa %xmm1, %xmm0
1210 ; SSSE3-NEXT:    retq
1211 ;
1212 ; SSE41-LABEL: shuffle_v8i16_cde3XXXX:
1213 ; SSE41:       # BB#0:
1214 ; SSE41-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,1,0,1]
1215 ; SSE41-NEXT:    punpckhwd {{.*#+}} xmm1 = xmm1[4],xmm0[4],xmm1[5],xmm0[5],xmm1[6],xmm0[6],xmm1[7],xmm0[7]
1216 ; SSE41-NEXT:    pshufb {{.*#+}} xmm1 = xmm1[0,1,4,5,8,9,14,15,8,9,14,15,12,13,14,15]
1217 ; SSE41-NEXT:    movdqa %xmm1, %xmm0
1218 ; SSE41-NEXT:    retq
1219 ;
1220 ; AVX1-LABEL: shuffle_v8i16_cde3XXXX:
1221 ; AVX1:       # BB#0:
1222 ; AVX1-NEXT:    vpshufd {{.*#+}} xmm0 = xmm0[0,1,0,1]
1223 ; AVX1-NEXT:    vpunpckhwd {{.*#+}} xmm0 = xmm1[4],xmm0[4],xmm1[5],xmm0[5],xmm1[6],xmm0[6],xmm1[7],xmm0[7]
1224 ; AVX1-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[0,1,4,5,8,9,14,15,8,9,14,15,12,13,14,15]
1225 ; AVX1-NEXT:    retq
1226 ;
1227 ; AVX2-LABEL: shuffle_v8i16_cde3XXXX:
1228 ; AVX2:       # BB#0:
1229 ; AVX2-NEXT:    vpbroadcastq %xmm0, %xmm0
1230 ; AVX2-NEXT:    vpunpckhwd {{.*#+}} xmm0 = xmm1[4],xmm0[4],xmm1[5],xmm0[5],xmm1[6],xmm0[6],xmm1[7],xmm0[7]
1231 ; AVX2-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[0,1,4,5,8,9,14,15,8,9,14,15,12,13,14,15]
1232 ; AVX2-NEXT:    retq
1233   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 12, i32 13, i32 14, i32 3, i32 undef, i32 undef, i32 undef, i32 undef>
1234   ret <8 x i16> %shuffle
1235 }
1236
1237 define <8 x i16> @shuffle_v8i16_012dcde3(<8 x i16> %a, <8 x i16> %b) {
1238 ; SSE2-LABEL: shuffle_v8i16_012dcde3:
1239 ; SSE2:       # BB#0:
1240 ; SSE2-NEXT:    pshufd {{.*#+}} xmm2 = xmm0[0,1,0,1]
1241 ; SSE2-NEXT:    pshufd {{.*#+}} xmm3 = xmm1[2,3,0,1]
1242 ; SSE2-NEXT:    punpckhwd {{.*#+}} xmm1 = xmm1[4],xmm2[4],xmm1[5],xmm2[5],xmm1[6],xmm2[6],xmm1[7],xmm2[7]
1243 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm1 = xmm1[0,2,2,3,4,5,6,7]
1244 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm1 = xmm1[0,1,2,3,4,7,6,7]
1245 ; SSE2-NEXT:    pshufd {{.*#+}} xmm1 = xmm1[0,2,2,3]
1246 ; SSE2-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm3[0],xmm0[1],xmm3[1],xmm0[2],xmm3[2],xmm0[3],xmm3[3]
1247 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[3,1,2,0]
1248 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,4,6,6,7]
1249 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[2,1,2,3]
1250 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[1,2,0,3,4,5,6,7]
1251 ; SSE2-NEXT:    punpcklqdq {{.*#+}} xmm0 = xmm0[0],xmm1[0]
1252 ; SSE2-NEXT:    retq
1253 ;
1254 ; SSSE3-LABEL: shuffle_v8i16_012dcde3:
1255 ; SSSE3:       # BB#0:
1256 ; SSSE3-NEXT:    pshufd {{.*#+}} xmm2 = xmm0[0,1,0,1]
1257 ; SSSE3-NEXT:    pshufd {{.*#+}} xmm3 = xmm1[2,3,0,1]
1258 ; SSSE3-NEXT:    punpckhwd {{.*#+}} xmm1 = xmm1[4],xmm2[4],xmm1[5],xmm2[5],xmm1[6],xmm2[6],xmm1[7],xmm2[7]
1259 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm1 = xmm1[0,1,4,5,8,9,14,15,8,9,14,15,12,13,14,15]
1260 ; SSSE3-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm3[0],xmm0[1],xmm3[1],xmm0[2],xmm3[2],xmm0[3],xmm3[3]
1261 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,4,5,8,9,6,7,8,9,0,1,0,1,2,3]
1262 ; SSSE3-NEXT:    punpcklqdq {{.*#+}} xmm0 = xmm0[0],xmm1[0]
1263 ; SSSE3-NEXT:    retq
1264 ;
1265 ; SSE41-LABEL: shuffle_v8i16_012dcde3:
1266 ; SSE41:       # BB#0:
1267 ; SSE41-NEXT:    pshufd {{.*#+}} xmm2 = xmm0[0,1,0,1]
1268 ; SSE41-NEXT:    pshufd {{.*#+}} xmm3 = xmm1[2,3,0,1]
1269 ; SSE41-NEXT:    punpckhwd {{.*#+}} xmm1 = xmm1[4],xmm2[4],xmm1[5],xmm2[5],xmm1[6],xmm2[6],xmm1[7],xmm2[7]
1270 ; SSE41-NEXT:    pshufb {{.*#+}} xmm1 = xmm1[0,1,4,5,8,9,14,15,8,9,14,15,12,13,14,15]
1271 ; SSE41-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm3[0],xmm0[1],xmm3[1],xmm0[2],xmm3[2],xmm0[3],xmm3[3]
1272 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,4,5,8,9,6,7,8,9,0,1,0,1,2,3]
1273 ; SSE41-NEXT:    punpcklqdq {{.*#+}} xmm0 = xmm0[0],xmm1[0]
1274 ; SSE41-NEXT:    retq
1275 ;
1276 ; AVX1-LABEL: shuffle_v8i16_012dcde3:
1277 ; AVX1:       # BB#0:
1278 ; AVX1-NEXT:    vpshufd {{.*#+}} xmm2 = xmm0[0,1,0,1]
1279 ; AVX1-NEXT:    vpunpckhwd {{.*#+}} xmm2 = xmm1[4],xmm2[4],xmm1[5],xmm2[5],xmm1[6],xmm2[6],xmm1[7],xmm2[7]
1280 ; AVX1-NEXT:    vpshufb {{.*#+}} xmm2 = xmm2[0,1,4,5,8,9,14,15,8,9,14,15,12,13,14,15]
1281 ; AVX1-NEXT:    vpshufd {{.*#+}} xmm1 = xmm1[2,3,0,1]
1282 ; AVX1-NEXT:    vpunpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
1283 ; AVX1-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[0,1,4,5,8,9,6,7,8,9,0,1,0,1,2,3]
1284 ; AVX1-NEXT:    vpunpcklqdq {{.*#+}} xmm0 = xmm0[0],xmm2[0]
1285 ; AVX1-NEXT:    retq
1286 ;
1287 ; AVX2-LABEL: shuffle_v8i16_012dcde3:
1288 ; AVX2:       # BB#0:
1289 ; AVX2-NEXT:    vpbroadcastq %xmm0, %xmm2
1290 ; AVX2-NEXT:    vpunpckhwd {{.*#+}} xmm2 = xmm1[4],xmm2[4],xmm1[5],xmm2[5],xmm1[6],xmm2[6],xmm1[7],xmm2[7]
1291 ; AVX2-NEXT:    vpshufb {{.*#+}} xmm2 = xmm2[0,1,4,5,8,9,14,15,8,9,14,15,12,13,14,15]
1292 ; AVX2-NEXT:    vpshufd {{.*#+}} xmm1 = xmm1[2,3,0,1]
1293 ; AVX2-NEXT:    vpunpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
1294 ; AVX2-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[0,1,4,5,8,9,6,7,8,9,0,1,0,1,2,3]
1295 ; AVX2-NEXT:    vpunpcklqdq {{.*#+}} xmm0 = xmm0[0],xmm2[0]
1296 ; AVX2-NEXT:    retq
1297   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 0, i32 1, i32 2, i32 13, i32 12, i32 13, i32 14, i32 3>
1298   ret <8 x i16> %shuffle
1299 }
1300
1301 define <8 x i16> @shuffle_v8i16_XXX1X579(<8 x i16> %a, <8 x i16> %b) {
1302 ; SSE2-LABEL: shuffle_v8i16_XXX1X579:
1303 ; SSE2:       # BB#0:
1304 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,7,5,6,7]
1305 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,2,3]
1306 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,1,3,2,4,5,6,7]
1307 ; SSE2-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
1308 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,4,6,6,7]
1309 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,1,2,1]
1310 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,1,2,2,4,5,6,7]
1311 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,4,4,5,7]
1312 ; SSE2-NEXT:    retq
1313 ;
1314 ; SSSE3-LABEL: shuffle_v8i16_XXX1X579:
1315 ; SSSE3:       # BB#0:
1316 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,2,3,10,11,14,15,14,15,10,11,12,13,14,15]
1317 ; SSSE3-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
1318 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,2,3,4,5,4,5,8,9,8,9,12,13,6,7]
1319 ; SSSE3-NEXT:    retq
1320 ;
1321 ; SSE41-LABEL: shuffle_v8i16_XXX1X579:
1322 ; SSE41:       # BB#0:
1323 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,2,3,10,11,14,15,14,15,10,11,12,13,14,15]
1324 ; SSE41-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
1325 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,2,3,4,5,4,5,8,9,8,9,12,13,6,7]
1326 ; SSE41-NEXT:    retq
1327 ;
1328 ; AVX-LABEL: shuffle_v8i16_XXX1X579:
1329 ; AVX:       # BB#0:
1330 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[0,1,2,3,10,11,14,15,14,15,10,11,12,13,14,15]
1331 ; AVX-NEXT:    vpunpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
1332 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[0,1,2,3,4,5,4,5,8,9,8,9,12,13,6,7]
1333 ; AVX-NEXT:    retq
1334   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 undef, i32 undef, i32 undef, i32 1, i32 undef, i32 5, i32 7, i32 9>
1335   ret <8 x i16> %shuffle
1336 }
1337
1338 define <8 x i16> @shuffle_v8i16_XX4X8acX(<8 x i16> %a, <8 x i16> %b) {
1339 ; SSE2-LABEL: shuffle_v8i16_XX4X8acX:
1340 ; SSE2:       # BB#0:
1341 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[2,3,0,1]
1342 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm1 = xmm1[0,2,2,3,4,5,6,7]
1343 ; SSE2-NEXT:    pshufd {{.*#+}} xmm1 = xmm1[0,2,2,3]
1344 ; SSE2-NEXT:    punpcklwd {{.*#+}} xmm1 = xmm1[0],xmm0[0],xmm1[1],xmm0[1],xmm1[2],xmm0[2],xmm1[3],xmm0[3]
1345 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm1[0,1,2,0,4,5,6,7]
1346 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,1,2,1]
1347 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,1,1,3,4,5,6,7]
1348 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,7,6,4,7]
1349 ; SSE2-NEXT:    retq
1350 ;
1351 ; SSSE3-LABEL: shuffle_v8i16_XX4X8acX:
1352 ; SSSE3:       # BB#0:
1353 ; SSSE3-NEXT:    pshufd {{.*#+}} xmm2 = xmm0[2,3,0,1]
1354 ; SSSE3-NEXT:    pshuflw {{.*#+}} xmm0 = xmm1[0,2,2,3,4,5,6,7]
1355 ; SSSE3-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,2,3]
1356 ; SSSE3-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm2[0],xmm0[1],xmm2[1],xmm0[2],xmm2[2],xmm0[3],xmm2[3]
1357 ; SSSE3-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,2,3,2,3,0,1,0,1,4,5,8,9,0,1]
1358 ; SSSE3-NEXT:    retq
1359 ;
1360 ; SSE41-LABEL: shuffle_v8i16_XX4X8acX:
1361 ; SSE41:       # BB#0:
1362 ; SSE41-NEXT:    pshufd {{.*#+}} xmm2 = xmm0[2,3,0,1]
1363 ; SSE41-NEXT:    pshuflw {{.*#+}} xmm0 = xmm1[0,2,2,3,4,5,6,7]
1364 ; SSE41-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,2,3]
1365 ; SSE41-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm2[0],xmm0[1],xmm2[1],xmm0[2],xmm2[2],xmm0[3],xmm2[3]
1366 ; SSE41-NEXT:    pshufb {{.*#+}} xmm0 = xmm0[0,1,2,3,2,3,0,1,0,1,4,5,8,9,0,1]
1367 ; SSE41-NEXT:    retq
1368 ;
1369 ; AVX-LABEL: shuffle_v8i16_XX4X8acX:
1370 ; AVX:       # BB#0:
1371 ; AVX-NEXT:    vpshufd {{.*#+}} xmm0 = xmm0[2,3,0,1]
1372 ; AVX-NEXT:    vpshuflw {{.*#+}} xmm1 = xmm1[0,2,2,3,4,5,6,7]
1373 ; AVX-NEXT:    vpshufd {{.*#+}} xmm1 = xmm1[0,2,2,3]
1374 ; AVX-NEXT:    vpunpcklwd {{.*#+}} xmm0 = xmm1[0],xmm0[0],xmm1[1],xmm0[1],xmm1[2],xmm0[2],xmm1[3],xmm0[3]
1375 ; AVX-NEXT:    vpshufb {{.*#+}} xmm0 = xmm0[0,1,2,3,2,3,0,1,0,1,4,5,8,9,0,1]
1376 ; AVX-NEXT:    retq
1377   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 undef, i32 undef, i32 4, i32 undef, i32 8, i32 10, i32 12, i32 undef>
1378   ret <8 x i16> %shuffle
1379 }
1380
1381 define <8 x i16> @shuffle_v8i16_8zzzzzzz(i16 %i) {
1382 ; SSE-LABEL: shuffle_v8i16_8zzzzzzz:
1383 ; SSE:       # BB#0:
1384 ; SSE-NEXT:    movzwl %di, %eax
1385 ; SSE-NEXT:    movd %eax, %xmm0
1386 ; SSE-NEXT:    retq
1387 ;
1388 ; AVX-LABEL: shuffle_v8i16_8zzzzzzz:
1389 ; AVX:       # BB#0:
1390 ; AVX-NEXT:    movzwl %di, %eax
1391 ; AVX-NEXT:    vmovd %eax, %xmm0
1392 ; AVX-NEXT:    retq
1393   %a = insertelement <8 x i16> undef, i16 %i, i32 0
1394   %shuffle = shufflevector <8 x i16> zeroinitializer, <8 x i16> %a, <8 x i32> <i32 8, i32 1, i32 2, i32 3, i32 4, i32 5, i32 6, i32 7>
1395   ret <8 x i16> %shuffle
1396 }
1397
1398 define <8 x i16> @shuffle_v8i16_z8zzzzzz(i16 %i) {
1399 ; SSE-LABEL: shuffle_v8i16_z8zzzzzz:
1400 ; SSE:       # BB#0:\r
1401 ; SSE-NEXT:    movzwl %di, %eax\r
1402 ; SSE-NEXT:    movd %eax, %xmm0\r
1403 ; SSE-NEXT:    pslldq {{.*#+}} xmm0 = zero,zero,xmm0[0,1,2,3,4,5,6,7,8,9,10,11,12,13]\r
1404 ; SSE-NEXT:    retq\r
1405 ;\r
1406 ; AVX-LABEL: shuffle_v8i16_z8zzzzzz:\r
1407 ; AVX:       # BB#0:\r
1408 ; AVX-NEXT:    movzwl %di, %eax\r
1409 ; AVX-NEXT:    vmovd %eax, %xmm0\r
1410 ; AVX-NEXT:    vpslldq {{.*#+}} xmm0 = zero,zero,xmm0[0,1,2,3,4,5,6,7,8,9,10,11,12,13]\r
1411 ; AVX-NEXT:    retq\r
1412   %a = insertelement <8 x i16> undef, i16 %i, i32 0\r
1413   %shuffle = shufflevector <8 x i16> zeroinitializer, <8 x i16> %a, <8 x i32> <i32 2, i32 8, i32 3, i32 7, i32 6, i32 5, i32 4, i32 3>\r
1414   ret <8 x i16> %shuffle
1415 }
1416
1417 define <8 x i16> @shuffle_v8i16_zzzzz8zz(i16 %i) {
1418 ; SSE-LABEL: shuffle_v8i16_zzzzz8zz:
1419 ; SSE:       # BB#0:\r
1420 ; SSE-NEXT:    movzwl %di, %eax\r
1421 ; SSE-NEXT:    movd %eax, %xmm0\r
1422 ; SSE-NEXT:    pslldq {{.*#+}} xmm0 = zero,zero,zero,zero,zero,zero,zero,zero,zero,zero,xmm0[0,1,2,3,4,5]\r
1423 ; SSE-NEXT:    retq\r
1424 ;\r
1425 ; AVX-LABEL: shuffle_v8i16_zzzzz8zz:\r
1426 ; AVX:       # BB#0:\r
1427 ; AVX-NEXT:    movzwl %di, %eax\r
1428 ; AVX-NEXT:    vmovd %eax, %xmm0\r
1429 ; AVX-NEXT:    vpslldq {{.*#+}} xmm0 = zero,zero,zero,zero,zero,zero,zero,zero,zero,zero,xmm0[0,1,2,3,4,5]\r
1430 ; AVX-NEXT:    retq\r
1431   %a = insertelement <8 x i16> undef, i16 %i, i32 0\r
1432   %shuffle = shufflevector <8 x i16> zeroinitializer, <8 x i16> %a, <8 x i32> <i32 0, i32 0, i32 0, i32 0, i32 0, i32 8, i32 0, i32 0>\r
1433   ret <8 x i16> %shuffle
1434 }
1435
1436 define <8 x i16> @shuffle_v8i16_zuuzuuz8(i16 %i) {
1437 ; SSE-LABEL: shuffle_v8i16_zuuzuuz8:
1438 ; SSE:       # BB#0:\r
1439 ; SSE-NEXT:    movzwl %di, %eax\r
1440 ; SSE-NEXT:    movd %eax, %xmm0\r
1441 ; SSE-NEXT:    pslldq {{.*#+}} xmm0 = zero,zero,zero,zero,zero,zero,zero,zero,zero,zero,zero,zero,zero,zero,xmm0[0,1]\r
1442 ; SSE-NEXT:    retq\r
1443 ;\r
1444 ; AVX-LABEL: shuffle_v8i16_zuuzuuz8:\r
1445 ; AVX:       # BB#0:\r
1446 ; AVX-NEXT:    movzwl %di, %eax\r
1447 ; AVX-NEXT:    vmovd %eax, %xmm0\r
1448 ; AVX-NEXT:    vpslldq {{.*#+}} xmm0 = zero,zero,zero,zero,zero,zero,zero,zero,zero,zero,zero,zero,zero,zero,xmm0[0,1]\r
1449 ; AVX-NEXT:    retq\r
1450   %a = insertelement <8 x i16> undef, i16 %i, i32 0\r
1451   %shuffle = shufflevector <8 x i16> zeroinitializer, <8 x i16> %a, <8 x i32> <i32 0, i32 undef, i32 undef, i32 3, i32 undef, i32 undef, i32 6, i32 8>\r
1452   ret <8 x i16> %shuffle
1453 }
1454
1455 define <8 x i16> @shuffle_v8i16_zzBzzzzz(i16 %i) {
1456 ; SSE-LABEL: shuffle_v8i16_zzBzzzzz:
1457 ; SSE:       # BB#0:\r
1458 ; SSE-NEXT:    movzwl %di, %eax\r
1459 ; SSE-NEXT:    movd %eax, %xmm0\r
1460 ; SSE-NEXT:    pslldq {{.*#+}} xmm0 = zero,zero,zero,zero,xmm0[0,1,2,3,4,5,6,7,8,9,10,11]\r
1461 ; SSE-NEXT:    retq\r
1462 ;\r
1463 ; AVX-LABEL: shuffle_v8i16_zzBzzzzz:\r
1464 ; AVX:       # BB#0:\r
1465 ; AVX-NEXT:    movzwl %di, %eax\r
1466 ; AVX-NEXT:    vmovd %eax, %xmm0\r
1467 ; AVX-NEXT:    vpslldq {{.*#+}} xmm0 = zero,zero,zero,zero,xmm0[0,1,2,3,4,5,6,7,8,9,10,11]\r
1468 ; AVX-NEXT:    retq\r
1469   %a = insertelement <8 x i16> undef, i16 %i, i32 3\r
1470   %shuffle = shufflevector <8 x i16> zeroinitializer, <8 x i16> %a, <8 x i32> <i32 0, i32 1, i32 11, i32 3, i32 4, i32 5, i32 6, i32 7>\r
1471   ret <8 x i16> %shuffle
1472 }
1473
1474 define <8 x i16> @shuffle_v8i16_def01234(<8 x i16> %a, <8 x i16> %b) {
1475 ; SSE2-LABEL: shuffle_v8i16_def01234:
1476 ; SSE2:       # BB#0:
1477 ; SSE2-NEXT:    pshufd {{.*#+}} xmm2 = xmm0[0,1,0,1]
1478 ; SSE2-NEXT:    punpckhwd {{.*#+}} xmm1 = xmm1[4],xmm2[4],xmm1[5],xmm2[5],xmm1[6],xmm2[6],xmm1[7],xmm2[7]
1479 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm1 = xmm1[2,1,2,3,4,5,6,7]
1480 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm1 = xmm1[0,1,2,3,4,6,6,7]
1481 ; SSE2-NEXT:    pshufd {{.*#+}} xmm1 = xmm1[0,2,2,3]
1482 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm1 = xmm1[0,2,3,1,4,5,6,7]
1483 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[3,1,2,0]
1484 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,4,7,6,7]
1485 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[2,1,2,3]
1486 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[1,2,3,0,4,5,6,7]
1487 ; SSE2-NEXT:    punpcklqdq {{.*#+}} xmm1 = xmm1[0],xmm0[0]
1488 ; SSE2-NEXT:    movdqa %xmm1, %xmm0
1489 ; SSE2-NEXT:    retq
1490 ;
1491 ; SSSE3-LABEL: shuffle_v8i16_def01234:
1492 ; SSSE3:       # BB#0:
1493 ; SSSE3-NEXT:    palignr {{.*#+}} xmm0 = xmm1[10,11,12,13,14,15],xmm0[0,1,2,3,4,5,6,7,8,9]
1494 ; SSSE3-NEXT:    retq
1495 ;
1496 ; SSE41-LABEL: shuffle_v8i16_def01234:
1497 ; SSE41:       # BB#0:
1498 ; SSE41-NEXT:    palignr {{.*#+}} xmm0 = xmm1[10,11,12,13,14,15],xmm0[0,1,2,3,4,5,6,7,8,9]
1499 ; SSE41-NEXT:    retq
1500 ;
1501 ; AVX-LABEL: shuffle_v8i16_def01234:
1502 ; AVX:       # BB#0:
1503 ; AVX-NEXT:    vpalignr {{.*#+}} xmm0 = xmm1[10,11,12,13,14,15],xmm0[0,1,2,3,4,5,6,7,8,9]
1504 ; AVX-NEXT:    retq
1505   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 13, i32 14, i32 15, i32 0, i32 1, i32 2, i32 3, i32 4>
1506   ret <8 x i16> %shuffle
1507 }
1508
1509 define <8 x i16> @shuffle_v8i16_ueuu123u(<8 x i16> %a, <8 x i16> %b) {
1510 ; SSE2-LABEL: shuffle_v8i16_ueuu123u:
1511 ; SSE2:       # BB#0:
1512 ; SSE2-NEXT:    pshufd {{.*#+}} xmm1 = xmm1[2,3,0,1]
1513 ; SSE2-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
1514 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,4,6,5,7]
1515 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,3,2,1]
1516 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,2,2,3,4,5,6,7]
1517 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,6,4,5,7]
1518 ; SSE2-NEXT:    retq
1519 ;
1520 ; SSSE3-LABEL: shuffle_v8i16_ueuu123u:
1521 ; SSSE3:       # BB#0:
1522 ; SSSE3-NEXT:    palignr {{.*#+}} xmm0 = xmm1[10,11,12,13,14,15],xmm0[0,1,2,3,4,5,6,7,8,9]
1523 ; SSSE3-NEXT:    retq
1524 ;
1525 ; SSE41-LABEL: shuffle_v8i16_ueuu123u:
1526 ; SSE41:       # BB#0:
1527 ; SSE41-NEXT:    palignr {{.*#+}} xmm0 = xmm1[10,11,12,13,14,15],xmm0[0,1,2,3,4,5,6,7,8,9]
1528 ; SSE41-NEXT:    retq
1529 ;
1530 ; AVX-LABEL: shuffle_v8i16_ueuu123u:
1531 ; AVX:       # BB#0:
1532 ; AVX-NEXT:    vpalignr {{.*#+}} xmm0 = xmm1[10,11,12,13,14,15],xmm0[0,1,2,3,4,5,6,7,8,9]
1533 ; AVX-NEXT:    retq
1534   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 undef, i32 14, i32 undef, i32 undef, i32 1, i32 2, i32 3, i32 undef>
1535   ret <8 x i16> %shuffle
1536 }
1537
1538 define <8 x i16> @shuffle_v8i16_56701234(<8 x i16> %a, <8 x i16> %b) {
1539 ; SSE2-LABEL: shuffle_v8i16_56701234:
1540 ; SSE2:       # BB#0:
1541 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,1,3]
1542 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,3,2,1,4,5,6,7]
1543 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,3,2,1]
1544 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[1,2,3,0,4,5,6,7]
1545 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,7,4,5,6]
1546 ; SSE2-NEXT:    retq
1547 ;
1548 ; SSSE3-LABEL: shuffle_v8i16_56701234:
1549 ; SSSE3:       # BB#0:
1550 ; SSSE3-NEXT:    palignr {{.*#+}} xmm0 = xmm0[10,11,12,13,14,15,0,1,2,3,4,5,6,7,8,9]
1551 ; SSSE3-NEXT:    retq
1552 ;
1553 ; SSE41-LABEL: shuffle_v8i16_56701234:
1554 ; SSE41:       # BB#0:
1555 ; SSE41-NEXT:    palignr {{.*#+}} xmm0 = xmm0[10,11,12,13,14,15,0,1,2,3,4,5,6,7,8,9]
1556 ; SSE41-NEXT:    retq
1557 ;
1558 ; AVX-LABEL: shuffle_v8i16_56701234:
1559 ; AVX:       # BB#0:
1560 ; AVX-NEXT:    vpalignr {{.*#+}} xmm0 = xmm0[10,11,12,13,14,15,0,1,2,3,4,5,6,7,8,9]
1561 ; AVX-NEXT:    retq
1562   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 5, i32 6, i32 7, i32 0, i32 1, i32 2, i32 3, i32 4>
1563   ret <8 x i16> %shuffle
1564 }
1565
1566 define <8 x i16> @shuffle_v8i16_u6uu123u(<8 x i16> %a, <8 x i16> %b) {
1567 ; SSE2-LABEL: shuffle_v8i16_u6uu123u:
1568 ; SSE2:       # BB#0:
1569 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,3,0,1]
1570 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,2,2,3,4,5,6,7]
1571 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,5,6,7,7]
1572 ; SSE2-NEXT:    retq
1573 ;
1574 ; SSSE3-LABEL: shuffle_v8i16_u6uu123u:
1575 ; SSSE3:       # BB#0:
1576 ; SSSE3-NEXT:    palignr {{.*#+}} xmm0 = xmm0[10,11,12,13,14,15,0,1,2,3,4,5,6,7,8,9]
1577 ; SSSE3-NEXT:    retq
1578 ;
1579 ; SSE41-LABEL: shuffle_v8i16_u6uu123u:
1580 ; SSE41:       # BB#0:
1581 ; SSE41-NEXT:    palignr {{.*#+}} xmm0 = xmm0[10,11,12,13,14,15,0,1,2,3,4,5,6,7,8,9]
1582 ; SSE41-NEXT:    retq
1583 ;
1584 ; AVX-LABEL: shuffle_v8i16_u6uu123u:
1585 ; AVX:       # BB#0:
1586 ; AVX-NEXT:    vpalignr {{.*#+}} xmm0 = xmm0[10,11,12,13,14,15,0,1,2,3,4,5,6,7,8,9]
1587 ; AVX-NEXT:    retq
1588   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 undef, i32 6, i32 undef, i32 undef, i32 1, i32 2, i32 3, i32 undef>
1589   ret <8 x i16> %shuffle
1590 }
1591
1592 define <8 x i16> @shuffle_v8i16_uuuu123u(<8 x i16> %a, <8 x i16> %b) {
1593 ; SSE2-LABEL: shuffle_v8i16_uuuu123u:
1594 ; SSE2:       # BB#0:
1595 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,1,0,1]
1596 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,5,6,7,7]
1597 ; SSE2-NEXT:    retq
1598 ;
1599 ; SSSE3-LABEL: shuffle_v8i16_uuuu123u:
1600 ; SSSE3:       # BB#0:
1601 ; SSSE3-NEXT:    palignr {{.*#+}} xmm0 = xmm0[10,11,12,13,14,15,0,1,2,3,4,5,6,7,8,9]
1602 ; SSSE3-NEXT:    retq
1603 ;
1604 ; SSE41-LABEL: shuffle_v8i16_uuuu123u:
1605 ; SSE41:       # BB#0:
1606 ; SSE41-NEXT:    palignr {{.*#+}} xmm0 = xmm0[10,11,12,13,14,15,0,1,2,3,4,5,6,7,8,9]
1607 ; SSE41-NEXT:    retq
1608 ;
1609 ; AVX-LABEL: shuffle_v8i16_uuuu123u:
1610 ; AVX:       # BB#0:
1611 ; AVX-NEXT:    vpalignr {{.*#+}} xmm0 = xmm0[10,11,12,13,14,15,0,1,2,3,4,5,6,7,8,9]
1612 ; AVX-NEXT:    retq
1613   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 undef, i32 undef, i32 undef, i32 undef, i32 1, i32 2, i32 3, i32 undef>
1614   ret <8 x i16> %shuffle
1615 }
1616
1617 define <8 x i16> @shuffle_v8i16_bcdef012(<8 x i16> %a, <8 x i16> %b) {
1618 ; SSE2-LABEL: shuffle_v8i16_bcdef012:
1619 ; SSE2:       # BB#0:
1620 ; SSE2-NEXT:    pshufd {{.*#+}} xmm2 = xmm1[2,3,0,1]
1621 ; SSE2-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm2[0],xmm0[1],xmm2[1],xmm0[2],xmm2[2],xmm0[3],xmm2[3]
1622 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,2,2,3,4,5,6,7]
1623 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,4,7,6,7]
1624 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,2,3]
1625 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm2 = xmm0[3,0,1,2,4,5,6,7]
1626 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm1[3,1,2,0]
1627 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,3,2,3,4,5,6,7]
1628 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,2,3]
1629 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[1,2,3,0,4,5,6,7]
1630 ; SSE2-NEXT:    punpcklqdq {{.*#+}} xmm0 = xmm0[0],xmm2[0]
1631 ; SSE2-NEXT:    retq
1632 ;
1633 ; SSSE3-LABEL: shuffle_v8i16_bcdef012:
1634 ; SSSE3:       # BB#0:
1635 ; SSSE3-NEXT:    palignr {{.*#+}} xmm0 = xmm1[6,7,8,9,10,11,12,13,14,15],xmm0[0,1,2,3,4,5]
1636 ; SSSE3-NEXT:    retq
1637 ;
1638 ; SSE41-LABEL: shuffle_v8i16_bcdef012:
1639 ; SSE41:       # BB#0:
1640 ; SSE41-NEXT:    palignr {{.*#+}} xmm0 = xmm1[6,7,8,9,10,11,12,13,14,15],xmm0[0,1,2,3,4,5]
1641 ; SSE41-NEXT:    retq
1642 ;
1643 ; AVX-LABEL: shuffle_v8i16_bcdef012:
1644 ; AVX:       # BB#0:
1645 ; AVX-NEXT:    vpalignr {{.*#+}} xmm0 = xmm1[6,7,8,9,10,11,12,13,14,15],xmm0[0,1,2,3,4,5]
1646 ; AVX-NEXT:    retq
1647   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 11, i32 12, i32 13, i32 14, i32 15, i32 0, i32 1, i32 2>
1648   ret <8 x i16> %shuffle
1649 }
1650
1651 define <8 x i16> @shuffle_v8i16_ucdeuu1u(<8 x i16> %a, <8 x i16> %b) {
1652 ; SSE2-LABEL: shuffle_v8i16_ucdeuu1u:
1653 ; SSE2:       # BB#0:
1654 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,1,0,1]
1655 ; SSE2-NEXT:    punpckhwd {{.*#+}} xmm1 = xmm1[4],xmm0[4],xmm1[5],xmm0[5],xmm1[6],xmm0[6],xmm1[7],xmm0[7]
1656 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm1[0,2,2,3,4,5,6,7]
1657 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,2,1]
1658 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,0,1,2,4,5,6,7]
1659 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,4,5,7,7]
1660 ; SSE2-NEXT:    retq
1661 ;
1662 ; SSSE3-LABEL: shuffle_v8i16_ucdeuu1u:
1663 ; SSSE3:       # BB#0:
1664 ; SSSE3-NEXT:    palignr {{.*#+}} xmm0 = xmm1[6,7,8,9,10,11,12,13,14,15],xmm0[0,1,2,3,4,5]
1665 ; SSSE3-NEXT:    retq
1666 ;
1667 ; SSE41-LABEL: shuffle_v8i16_ucdeuu1u:
1668 ; SSE41:       # BB#0:
1669 ; SSE41-NEXT:    palignr {{.*#+}} xmm0 = xmm1[6,7,8,9,10,11,12,13,14,15],xmm0[0,1,2,3,4,5]
1670 ; SSE41-NEXT:    retq
1671 ;
1672 ; AVX-LABEL: shuffle_v8i16_ucdeuu1u:
1673 ; AVX:       # BB#0:
1674 ; AVX-NEXT:    vpalignr {{.*#+}} xmm0 = xmm1[6,7,8,9,10,11,12,13,14,15],xmm0[0,1,2,3,4,5]
1675 ; AVX-NEXT:    retq
1676   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 undef, i32 12, i32 13, i32 14, i32 undef, i32 undef, i32 1, i32 undef>
1677   ret <8 x i16> %shuffle
1678 }
1679
1680 define <8 x i16> @shuffle_v8i16_34567012(<8 x i16> %a, <8 x i16> %b) {
1681 ; SSE2-LABEL: shuffle_v8i16_34567012:
1682 ; SSE2:       # BB#0:
1683 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[3,1,2,0]
1684 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,3,2,1,4,5,6,7]
1685 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,1,3]
1686 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[1,2,3,0,4,5,6,7]
1687 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,5,6,7,4]
1688 ; SSE2-NEXT:    retq
1689 ;
1690 ; SSSE3-LABEL: shuffle_v8i16_34567012:
1691 ; SSSE3:       # BB#0:
1692 ; SSSE3-NEXT:    palignr {{.*#+}} xmm0 = xmm0[6,7,8,9,10,11,12,13,14,15,0,1,2,3,4,5]
1693 ; SSSE3-NEXT:    retq
1694 ;
1695 ; SSE41-LABEL: shuffle_v8i16_34567012:
1696 ; SSE41:       # BB#0:
1697 ; SSE41-NEXT:    palignr {{.*#+}} xmm0 = xmm0[6,7,8,9,10,11,12,13,14,15,0,1,2,3,4,5]
1698 ; SSE41-NEXT:    retq
1699 ;
1700 ; AVX-LABEL: shuffle_v8i16_34567012:
1701 ; AVX:       # BB#0:
1702 ; AVX-NEXT:    vpalignr {{.*#+}} xmm0 = xmm0[6,7,8,9,10,11,12,13,14,15,0,1,2,3,4,5]
1703 ; AVX-NEXT:    retq
1704   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 3, i32 4, i32 5, i32 6, i32 7, i32 0, i32 1, i32 2>
1705   ret <8 x i16> %shuffle
1706 }
1707
1708 define <8 x i16> @shuffle_v8i16_u456uu1u(<8 x i16> %a, <8 x i16> %b) {
1709 ; SSE2-LABEL: shuffle_v8i16_u456uu1u:
1710 ; SSE2:       # BB#0:
1711 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[2,3,0,3]
1712 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,0,1,2,4,5,6,7]
1713 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,4,5,5,7]
1714 ; SSE2-NEXT:    retq
1715 ;
1716 ; SSSE3-LABEL: shuffle_v8i16_u456uu1u:
1717 ; SSSE3:       # BB#0:
1718 ; SSSE3-NEXT:    palignr {{.*#+}} xmm0 = xmm0[6,7,8,9,10,11,12,13,14,15,0,1,2,3,4,5]
1719 ; SSSE3-NEXT:    retq
1720 ;
1721 ; SSE41-LABEL: shuffle_v8i16_u456uu1u:
1722 ; SSE41:       # BB#0:
1723 ; SSE41-NEXT:    palignr {{.*#+}} xmm0 = xmm0[6,7,8,9,10,11,12,13,14,15,0,1,2,3,4,5]
1724 ; SSE41-NEXT:    retq
1725 ;
1726 ; AVX-LABEL: shuffle_v8i16_u456uu1u:
1727 ; AVX:       # BB#0:
1728 ; AVX-NEXT:    vpalignr {{.*#+}} xmm0 = xmm0[6,7,8,9,10,11,12,13,14,15,0,1,2,3,4,5]
1729 ; AVX-NEXT:    retq
1730   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 undef, i32 4, i32 5, i32 6, i32 undef, i32 undef, i32 1, i32 undef>
1731   ret <8 x i16> %shuffle
1732 }
1733
1734 define <8 x i16> @shuffle_v8i16_u456uuuu(<8 x i16> %a, <8 x i16> %b) {
1735 ; SSE2-LABEL: shuffle_v8i16_u456uuuu:
1736 ; SSE2:       # BB#0:
1737 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[2,3,2,3]
1738 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,0,1,2,4,5,6,7]
1739 ; SSE2-NEXT:    retq
1740 ;
1741 ; SSSE3-LABEL: shuffle_v8i16_u456uuuu:
1742 ; SSSE3:       # BB#0:
1743 ; SSSE3-NEXT:    palignr {{.*#+}} xmm0 = xmm0[6,7,8,9,10,11,12,13,14,15,0,1,2,3,4,5]
1744 ; SSSE3-NEXT:    retq
1745 ;
1746 ; SSE41-LABEL: shuffle_v8i16_u456uuuu:
1747 ; SSE41:       # BB#0:
1748 ; SSE41-NEXT:    palignr {{.*#+}} xmm0 = xmm0[6,7,8,9,10,11,12,13,14,15,0,1,2,3,4,5]
1749 ; SSE41-NEXT:    retq
1750 ;
1751 ; AVX-LABEL: shuffle_v8i16_u456uuuu:
1752 ; AVX:       # BB#0:
1753 ; AVX-NEXT:    vpalignr {{.*#+}} xmm0 = xmm0[6,7,8,9,10,11,12,13,14,15,0,1,2,3,4,5]
1754 ; AVX-NEXT:    retq
1755   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 undef, i32 4, i32 5, i32 6, i32 undef, i32 undef, i32 undef, i32 undef>
1756   ret <8 x i16> %shuffle
1757 }
1758
1759 define <8 x i16> @shuffle_v8i16_3456789a(<8 x i16> %a, <8 x i16> %b) {
1760 ; SSE2-LABEL: shuffle_v8i16_3456789a:
1761 ; SSE2:       # BB#0:
1762 ; SSE2-NEXT:    pshufd {{.*#+}} xmm2 = xmm0[2,3,0,1]
1763 ; SSE2-NEXT:    punpcklwd {{.*#+}} xmm1 = xmm1[0],xmm2[0],xmm1[1],xmm2[1],xmm1[2],xmm2[2],xmm1[3],xmm2[3]
1764 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm1 = xmm1[0,2,2,3,4,5,6,7]
1765 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm1 = xmm1[0,1,2,3,4,7,6,7]
1766 ; SSE2-NEXT:    pshufd {{.*#+}} xmm1 = xmm1[0,2,2,3]
1767 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm1 = xmm1[3,0,1,2,4,5,6,7]
1768 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[3,1,2,0]
1769 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,3,2,3,4,5,6,7]
1770 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,2,3]
1771 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[1,2,3,0,4,5,6,7]
1772 ; SSE2-NEXT:    punpcklqdq {{.*#+}} xmm0 = xmm0[0],xmm1[0]
1773 ; SSE2-NEXT:    retq
1774 ;
1775 ; SSSE3-LABEL: shuffle_v8i16_3456789a:
1776 ; SSSE3:       # BB#0:
1777 ; SSSE3-NEXT:    palignr {{.*#+}} xmm1 = xmm0[6,7,8,9,10,11,12,13,14,15],xmm1[0,1,2,3,4,5]
1778 ; SSSE3-NEXT:    movdqa %xmm1, %xmm0
1779 ; SSSE3-NEXT:    retq
1780 ;
1781 ; SSE41-LABEL: shuffle_v8i16_3456789a:
1782 ; SSE41:       # BB#0:
1783 ; SSE41-NEXT:    palignr {{.*#+}} xmm1 = xmm0[6,7,8,9,10,11,12,13,14,15],xmm1[0,1,2,3,4,5]
1784 ; SSE41-NEXT:    movdqa %xmm1, %xmm0
1785 ; SSE41-NEXT:    retq
1786 ;
1787 ; AVX-LABEL: shuffle_v8i16_3456789a:
1788 ; AVX:       # BB#0:
1789 ; AVX-NEXT:    vpalignr {{.*#+}} xmm0 = xmm0[6,7,8,9,10,11,12,13,14,15],xmm1[0,1,2,3,4,5]
1790 ; AVX-NEXT:    retq
1791   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 3, i32 4, i32 5, i32 6, i32 7, i32 8, i32 9, i32 10>
1792   ret <8 x i16> %shuffle
1793 }
1794
1795 define <8 x i16> @shuffle_v8i16_u456uu9u(<8 x i16> %a, <8 x i16> %b) {
1796 ; SSE2-LABEL: shuffle_v8i16_u456uu9u:
1797 ; SSE2:       # BB#0:
1798 ; SSE2-NEXT:    pshufd {{.*#+}} xmm1 = xmm1[0,1,0,1]
1799 ; SSE2-NEXT:    punpckhwd {{.*#+}} xmm0 = xmm0[4],xmm1[4],xmm0[5],xmm1[5],xmm0[6],xmm1[6],xmm0[7],xmm1[7]
1800 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,2,2,3,4,5,6,7]
1801 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,2,1]
1802 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,0,1,2,4,5,6,7]
1803 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,4,5,7,7]
1804 ; SSE2-NEXT:    retq
1805 ;
1806 ; SSSE3-LABEL: shuffle_v8i16_u456uu9u:
1807 ; SSSE3:       # BB#0:
1808 ; SSSE3-NEXT:    palignr {{.*#+}} xmm1 = xmm0[6,7,8,9,10,11,12,13,14,15],xmm1[0,1,2,3,4,5]
1809 ; SSSE3-NEXT:    movdqa %xmm1, %xmm0
1810 ; SSSE3-NEXT:    retq
1811 ;
1812 ; SSE41-LABEL: shuffle_v8i16_u456uu9u:
1813 ; SSE41:       # BB#0:
1814 ; SSE41-NEXT:    palignr {{.*#+}} xmm1 = xmm0[6,7,8,9,10,11,12,13,14,15],xmm1[0,1,2,3,4,5]
1815 ; SSE41-NEXT:    movdqa %xmm1, %xmm0
1816 ; SSE41-NEXT:    retq
1817 ;
1818 ; AVX-LABEL: shuffle_v8i16_u456uu9u:
1819 ; AVX:       # BB#0:
1820 ; AVX-NEXT:    vpalignr {{.*#+}} xmm0 = xmm0[6,7,8,9,10,11,12,13,14,15],xmm1[0,1,2,3,4,5]
1821 ; AVX-NEXT:    retq
1822   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 undef, i32 4, i32 5, i32 6, i32 undef, i32 undef, i32 9, i32 undef>
1823   ret <8 x i16> %shuffle
1824 }
1825
1826 define <8 x i16> @shuffle_v8i16_56789abc(<8 x i16> %a, <8 x i16> %b) {
1827 ; SSE2-LABEL: shuffle_v8i16_56789abc:
1828 ; SSE2:       # BB#0:
1829 ; SSE2-NEXT:    pshufd {{.*#+}} xmm2 = xmm1[0,1,0,1]
1830 ; SSE2-NEXT:    punpckhwd {{.*#+}} xmm0 = xmm0[4],xmm2[4],xmm0[5],xmm2[5],xmm0[6],xmm2[6],xmm0[7],xmm2[7]
1831 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[2,1,2,3,4,5,6,7]
1832 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,4,6,6,7]
1833 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,2,2,3]
1834 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,2,3,1,4,5,6,7]
1835 ; SSE2-NEXT:    pshufd {{.*#+}} xmm1 = xmm1[3,1,2,0]
1836 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm1 = xmm1[0,1,2,3,4,7,6,7]
1837 ; SSE2-NEXT:    pshufd {{.*#+}} xmm1 = xmm1[2,1,2,3]
1838 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm1 = xmm1[1,2,3,0,4,5,6,7]
1839 ; SSE2-NEXT:    punpcklqdq {{.*#+}} xmm0 = xmm0[0],xmm1[0]
1840 ; SSE2-NEXT:    retq
1841 ;
1842 ; SSSE3-LABEL: shuffle_v8i16_56789abc:
1843 ; SSSE3:       # BB#0:
1844 ; SSSE3-NEXT:    palignr {{.*#+}} xmm1 = xmm0[10,11,12,13,14,15],xmm1[0,1,2,3,4,5,6,7,8,9]
1845 ; SSSE3-NEXT:    movdqa %xmm1, %xmm0
1846 ; SSSE3-NEXT:    retq
1847 ;
1848 ; SSE41-LABEL: shuffle_v8i16_56789abc:
1849 ; SSE41:       # BB#0:
1850 ; SSE41-NEXT:    palignr {{.*#+}} xmm1 = xmm0[10,11,12,13,14,15],xmm1[0,1,2,3,4,5,6,7,8,9]
1851 ; SSE41-NEXT:    movdqa %xmm1, %xmm0
1852 ; SSE41-NEXT:    retq
1853 ;
1854 ; AVX-LABEL: shuffle_v8i16_56789abc:
1855 ; AVX:       # BB#0:
1856 ; AVX-NEXT:    vpalignr {{.*#+}} xmm0 = xmm0[10,11,12,13,14,15],xmm1[0,1,2,3,4,5,6,7,8,9]
1857 ; AVX-NEXT:    retq
1858   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 5, i32 6, i32 7, i32 8, i32 9, i32 10, i32 11, i32 12>
1859   ret <8 x i16> %shuffle
1860 }
1861
1862 define <8 x i16> @shuffle_v8i16_u6uu9abu(<8 x i16> %a, <8 x i16> %b) {
1863 ; SSE2-LABEL: shuffle_v8i16_u6uu9abu:
1864 ; SSE2:       # BB#0:
1865 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[2,3,0,1]
1866 ; SSE2-NEXT:    punpcklwd {{.*#+}} xmm1 = xmm1[0],xmm0[0],xmm1[1],xmm0[1],xmm1[2],xmm0[2],xmm1[3],xmm0[3]
1867 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm1[0,1,2,3,4,6,5,7]
1868 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,3,2,1]
1869 ; SSE2-NEXT:    pshuflw {{.*#+}} xmm0 = xmm0[0,2,2,3,4,5,6,7]
1870 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,6,4,5,7]
1871 ; SSE2-NEXT:    retq
1872 ;
1873 ; SSSE3-LABEL: shuffle_v8i16_u6uu9abu:
1874 ; SSSE3:       # BB#0:
1875 ; SSSE3-NEXT:    palignr {{.*#+}} xmm1 = xmm0[10,11,12,13,14,15],xmm1[0,1,2,3,4,5,6,7,8,9]
1876 ; SSSE3-NEXT:    movdqa %xmm1, %xmm0
1877 ; SSSE3-NEXT:    retq
1878 ;
1879 ; SSE41-LABEL: shuffle_v8i16_u6uu9abu:
1880 ; SSE41:       # BB#0:
1881 ; SSE41-NEXT:    palignr {{.*#+}} xmm1 = xmm0[10,11,12,13,14,15],xmm1[0,1,2,3,4,5,6,7,8,9]
1882 ; SSE41-NEXT:    movdqa %xmm1, %xmm0
1883 ; SSE41-NEXT:    retq
1884 ;
1885 ; AVX-LABEL: shuffle_v8i16_u6uu9abu:
1886 ; AVX:       # BB#0:
1887 ; AVX-NEXT:    vpalignr {{.*#+}} xmm0 = xmm0[10,11,12,13,14,15],xmm1[0,1,2,3,4,5,6,7,8,9]
1888 ; AVX-NEXT:    retq
1889   %shuffle = shufflevector <8 x i16> %a, <8 x i16> %b, <8 x i32> <i32 undef, i32 6, i32 undef, i32 undef, i32 9, i32 10, i32 11, i32 undef>
1890   ret <8 x i16> %shuffle
1891 }
1892
1893 define <8 x i16> @shuffle_v8i16_0uuu1uuu(<8 x i16> %a) {
1894 ; SSE2-LABEL: shuffle_v8i16_0uuu1uuu:
1895 ; SSE2:       # BB#0:
1896 ; SSE2-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,1,0,3]
1897 ; SSE2-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,5,5,6,7]
1898 ; SSE2-NEXT:    retq
1899 ;
1900 ; SSSE3-LABEL: shuffle_v8i16_0uuu1uuu:
1901 ; SSSE3:       # BB#0:
1902 ; SSSE3-NEXT:    pshufd {{.*#+}} xmm0 = xmm0[0,1,0,3]
1903 ; SSSE3-NEXT:    pshufhw {{.*#+}} xmm0 = xmm0[0,1,2,3,5,5,6,7]
1904 ; SSSE3-NEXT:    retq
1905 ;
1906 ; SSE41-LABEL: shuffle_v8i16_0uuu1uuu:
1907 ; SSE41:       # BB#0:
1908 ; SSE41-NEXT:    pmovzxwq %xmm0, %xmm0
1909 ; SSE41-NEXT:    retq
1910 ;
1911 ; AVX-LABEL: shuffle_v8i16_0uuu1uuu:
1912 ; AVX:       # BB#0:
1913 ; AVX-NEXT:    vpmovzxwq %xmm0, %xmm0
1914 ; AVX-NEXT:    retq
1915   %shuffle = shufflevector <8 x i16> %a, <8 x i16> zeroinitializer, <8 x i32> <i32 0, i32 undef, i32 undef, i32 undef, i32 1, i32 undef, i32 undef, i32 undef>
1916   ret <8 x i16> %shuffle
1917 }
1918
1919 define <8 x i16> @shuffle_v8i16_0zzz1zzz(<8 x i16> %a) {
1920 ; SSE2-LABEL: shuffle_v8i16_0zzz1zzz:
1921 ; SSE2:       # BB#0:
1922 ; SSE2-NEXT:    pxor %xmm1, %xmm1
1923 ; SSE2-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
1924 ; SSE2-NEXT:    punpckldq {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1]
1925 ; SSE2-NEXT:    retq
1926 ;
1927 ; SSSE3-LABEL: shuffle_v8i16_0zzz1zzz:
1928 ; SSSE3:       # BB#0:
1929 ; SSSE3-NEXT:    pxor %xmm1, %xmm1
1930 ; SSSE3-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
1931 ; SSSE3-NEXT:    punpckldq {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1]
1932 ; SSSE3-NEXT:    retq
1933 ;
1934 ; SSE41-LABEL: shuffle_v8i16_0zzz1zzz:
1935 ; SSE41:       # BB#0:
1936 ; SSE41-NEXT:    pmovzxwq %xmm0, %xmm0
1937 ; SSE41-NEXT:    retq
1938 ;
1939 ; AVX-LABEL: shuffle_v8i16_0zzz1zzz:
1940 ; AVX:       # BB#0:
1941 ; AVX-NEXT:    vpmovzxwq %xmm0, %xmm0
1942 ; AVX-NEXT:    retq
1943   %shuffle = shufflevector <8 x i16> %a, <8 x i16> zeroinitializer, <8 x i32> <i32 0, i32 9, i32 10, i32 11, i32 1, i32 13, i32 14, i32 15>
1944   ret <8 x i16> %shuffle
1945 }
1946
1947 define <8 x i16> @shuffle_v8i16_0u1u2u3u(<8 x i16> %a) {
1948 ; SSE2-LABEL: shuffle_v8i16_0u1u2u3u:
1949 ; SSE2:       # BB#0:
1950 ; SSE2-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0,0,1,1,2,2,3,3]
1951 ; SSE2-NEXT:    retq
1952 ;
1953 ; SSSE3-LABEL: shuffle_v8i16_0u1u2u3u:
1954 ; SSSE3:       # BB#0:
1955 ; SSSE3-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0,0,1,1,2,2,3,3]
1956 ; SSSE3-NEXT:    retq
1957 ;
1958 ; SSE41-LABEL: shuffle_v8i16_0u1u2u3u:
1959 ; SSE41:       # BB#0:
1960 ; SSE41-NEXT:    pmovzxwd %xmm0, %xmm0
1961 ; SSE41-NEXT:    retq
1962 ;
1963 ; AVX-LABEL: shuffle_v8i16_0u1u2u3u:
1964 ; AVX:       # BB#0:
1965 ; AVX-NEXT:    vpmovzxwd %xmm0, %xmm0
1966 ; AVX-NEXT:    retq
1967   %shuffle = shufflevector <8 x i16> %a, <8 x i16> zeroinitializer, <8 x i32> <i32 0, i32 undef, i32 1, i32 undef, i32 2, i32 undef, i32 3, i32 undef>
1968   ret <8 x i16> %shuffle
1969 }
1970
1971 define <8 x i16> @shuffle_v8i16_0z1z2z3z(<8 x i16> %a) {
1972 ; SSE2-LABEL: shuffle_v8i16_0z1z2z3z:
1973 ; SSE2:       # BB#0:
1974 ; SSE2-NEXT:    pxor %xmm1, %xmm1
1975 ; SSE2-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
1976 ; SSE2-NEXT:    retq
1977 ;
1978 ; SSSE3-LABEL: shuffle_v8i16_0z1z2z3z:
1979 ; SSSE3:       # BB#0:
1980 ; SSSE3-NEXT:    pxor %xmm1, %xmm1
1981 ; SSSE3-NEXT:    punpcklwd {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1],xmm0[2],xmm1[2],xmm0[3],xmm1[3]
1982 ; SSSE3-NEXT:    retq
1983 ;
1984 ; SSE41-LABEL: shuffle_v8i16_0z1z2z3z:
1985 ; SSE41:       # BB#0:
1986 ; SSE41-NEXT:    pmovzxwd %xmm0, %xmm0
1987 ; SSE41-NEXT:    retq
1988 ;
1989 ; AVX-LABEL: shuffle_v8i16_0z1z2z3z:
1990 ; AVX:       # BB#0:
1991 ; AVX-NEXT:    vpmovzxwd %xmm0, %xmm0
1992 ; AVX-NEXT:    retq
1993   %shuffle = shufflevector <8 x i16> %a, <8 x i16> zeroinitializer, <8 x i32> <i32 0, i32 9, i32 1, i32 11, i32 2, i32 13, i32 3, i32 15>
1994   ret <8 x i16> %shuffle
1995 }