forked from OSchip/llvm-project
[clang][AVX512] completing missing intrinsics for [vpermt2d|vptestm] instruction set.
Differential Revision: http://reviews.llvm.org/D20096 llvm-svn: 269170
This commit is contained in:
parent
aeb1fe8f20
commit
5e2c6b6200
|
@ -2830,6 +2830,29 @@ _mm512_permutex2var_epi32(__m512i __A, __m512i __I, __m512i __B)
|
||||||
(__v16si) __B,
|
(__v16si) __B,
|
||||||
(__mmask16) -1);
|
(__mmask16) -1);
|
||||||
}
|
}
|
||||||
|
|
||||||
|
static __inline__ __m512i __DEFAULT_FN_ATTRS
|
||||||
|
_mm512_mask_permutex2var_epi32 (__m512i __A, __mmask16 __U,
|
||||||
|
__m512i __I, __m512i __B)
|
||||||
|
{
|
||||||
|
return (__m512i) __builtin_ia32_vpermt2vard512_mask ((__v16si) __I
|
||||||
|
/* idx */ ,
|
||||||
|
(__v16si) __A,
|
||||||
|
(__v16si) __B,
|
||||||
|
(__mmask16) __U);
|
||||||
|
}
|
||||||
|
|
||||||
|
static __inline__ __m512i __DEFAULT_FN_ATTRS
|
||||||
|
_mm512_maskz_permutex2var_epi32 (__mmask16 __U, __m512i __A,
|
||||||
|
__m512i __I, __m512i __B)
|
||||||
|
{
|
||||||
|
return (__m512i) __builtin_ia32_vpermt2vard512_maskz ((__v16si) __I
|
||||||
|
/* idx */ ,
|
||||||
|
(__v16si) __A,
|
||||||
|
(__v16si) __B,
|
||||||
|
(__mmask16) __U);
|
||||||
|
}
|
||||||
|
|
||||||
static __inline __m512i __DEFAULT_FN_ATTRS
|
static __inline __m512i __DEFAULT_FN_ATTRS
|
||||||
_mm512_permutex2var_epi64(__m512i __A, __m512i __I, __m512i __B)
|
_mm512_permutex2var_epi64(__m512i __A, __m512i __I, __m512i __B)
|
||||||
{
|
{
|
||||||
|
@ -2840,23 +2863,27 @@ _mm512_permutex2var_epi64(__m512i __A, __m512i __I, __m512i __B)
|
||||||
(__mmask8) -1);
|
(__mmask8) -1);
|
||||||
}
|
}
|
||||||
|
|
||||||
static __inline __m512d __DEFAULT_FN_ATTRS
|
static __inline__ __m512i __DEFAULT_FN_ATTRS
|
||||||
_mm512_permutex2var_pd(__m512d __A, __m512i __I, __m512d __B)
|
_mm512_mask_permutex2var_epi64 (__m512i __A, __mmask8 __U, __m512i __I,
|
||||||
|
__m512i __B)
|
||||||
{
|
{
|
||||||
return (__m512d) __builtin_ia32_vpermt2varpd512_mask ((__v8di) __I
|
return (__m512i) __builtin_ia32_vpermt2varq512_mask ((__v8di) __I
|
||||||
/* idx */ ,
|
|
||||||
(__v8df) __A,
|
|
||||||
(__v8df) __B,
|
|
||||||
(__mmask8) -1);
|
|
||||||
}
|
|
||||||
static __inline __m512 __DEFAULT_FN_ATTRS
|
|
||||||
_mm512_permutex2var_ps(__m512 __A, __m512i __I, __m512 __B)
|
|
||||||
{
|
|
||||||
return (__m512) __builtin_ia32_vpermt2varps512_mask ((__v16si) __I
|
|
||||||
/* idx */ ,
|
/* idx */ ,
|
||||||
(__v16sf) __A,
|
(__v8di) __A,
|
||||||
(__v16sf) __B,
|
(__v8di) __B,
|
||||||
(__mmask16) -1);
|
(__mmask8) __U);
|
||||||
|
}
|
||||||
|
|
||||||
|
|
||||||
|
static __inline__ __m512i __DEFAULT_FN_ATTRS
|
||||||
|
_mm512_maskz_permutex2var_epi64 (__mmask8 __U, __m512i __A,
|
||||||
|
__m512i __I, __m512i __B)
|
||||||
|
{
|
||||||
|
return (__m512i) __builtin_ia32_vpermt2varq512_maskz ((__v8di) __I
|
||||||
|
/* idx */ ,
|
||||||
|
(__v8di) __A,
|
||||||
|
(__v8di) __B,
|
||||||
|
(__mmask8) __U);
|
||||||
}
|
}
|
||||||
|
|
||||||
#define _mm512_alignr_epi64(A, B, I) __extension__ ({ \
|
#define _mm512_alignr_epi64(A, B, I) __extension__ ({ \
|
||||||
|
@ -3466,6 +3493,13 @@ _mm512_test_epi32_mask(__m512i __A, __m512i __B)
|
||||||
(__mmask16) -1);
|
(__mmask16) -1);
|
||||||
}
|
}
|
||||||
|
|
||||||
|
static __inline__ __mmask16 __DEFAULT_FN_ATTRS
|
||||||
|
_mm512_mask_test_epi32_mask (__mmask16 __U, __m512i __A, __m512i __B)
|
||||||
|
{
|
||||||
|
return (__mmask16) __builtin_ia32_ptestmd512 ((__v16si) __A,
|
||||||
|
(__v16si) __B, __U);
|
||||||
|
}
|
||||||
|
|
||||||
static __inline __mmask8 __DEFAULT_FN_ATTRS
|
static __inline __mmask8 __DEFAULT_FN_ATTRS
|
||||||
_mm512_test_epi64_mask(__m512i __A, __m512i __B)
|
_mm512_test_epi64_mask(__m512i __A, __m512i __B)
|
||||||
{
|
{
|
||||||
|
@ -3474,6 +3508,13 @@ _mm512_test_epi64_mask(__m512i __A, __m512i __B)
|
||||||
(__mmask8) -1);
|
(__mmask8) -1);
|
||||||
}
|
}
|
||||||
|
|
||||||
|
static __inline__ __mmask8 __DEFAULT_FN_ATTRS
|
||||||
|
_mm512_mask_test_epi64_mask (__mmask8 __U, __m512i __A, __m512i __B)
|
||||||
|
{
|
||||||
|
return (__mmask8) __builtin_ia32_ptestmq512 ((__v8di) __A, (__v8di) __B, __U);
|
||||||
|
}
|
||||||
|
|
||||||
|
|
||||||
/* SIMD load ops */
|
/* SIMD load ops */
|
||||||
|
|
||||||
static __inline __m512i __DEFAULT_FN_ATTRS
|
static __inline __m512i __DEFAULT_FN_ATTRS
|
||||||
|
@ -5903,15 +5944,24 @@ _mm512_maskz_permutevar_ps (__mmask16 __U, __m512 __A, __m512i __C)
|
||||||
(__mmask16) __U);
|
(__mmask16) __U);
|
||||||
}
|
}
|
||||||
|
|
||||||
static __inline__ __m512i __DEFAULT_FN_ATTRS
|
static __inline __m512d __DEFAULT_FN_ATTRS
|
||||||
_mm512_maskz_permutex2var_epi32 (__mmask16 __U, __m512i __A,
|
_mm512_permutex2var_pd(__m512d __A, __m512i __I, __m512d __B)
|
||||||
__m512i __I, __m512i __B)
|
|
||||||
{
|
{
|
||||||
return (__m512i) __builtin_ia32_vpermt2vard512_maskz ((__v16si) __I
|
return (__m512d) __builtin_ia32_vpermt2varpd512_mask ((__v8di) __I
|
||||||
/* idx */ ,
|
/* idx */ ,
|
||||||
(__v16si) __A,
|
(__v8df) __A,
|
||||||
(__v16si) __B,
|
(__v8df) __B,
|
||||||
(__mmask16) __U);
|
(__mmask8) -1);
|
||||||
|
}
|
||||||
|
|
||||||
|
static __inline__ __m512d __DEFAULT_FN_ATTRS
|
||||||
|
_mm512_mask_permutex2var_pd (__m512d __A, __mmask8 __U, __m512i __I, __m512d __B)
|
||||||
|
{
|
||||||
|
return (__m512d) __builtin_ia32_vpermt2varpd512_mask ((__v8di) __I
|
||||||
|
/* idx */ ,
|
||||||
|
(__v8df) __A,
|
||||||
|
(__v8df) __B,
|
||||||
|
(__mmask8) __U);
|
||||||
}
|
}
|
||||||
|
|
||||||
static __inline__ __m512d __DEFAULT_FN_ATTRS
|
static __inline__ __m512d __DEFAULT_FN_ATTRS
|
||||||
|
@ -5919,10 +5969,30 @@ _mm512_maskz_permutex2var_pd (__mmask8 __U, __m512d __A, __m512i __I,
|
||||||
__m512d __B)
|
__m512d __B)
|
||||||
{
|
{
|
||||||
return (__m512d) __builtin_ia32_vpermt2varpd512_maskz ((__v8di) __I
|
return (__m512d) __builtin_ia32_vpermt2varpd512_maskz ((__v8di) __I
|
||||||
/* idx */ ,
|
/* idx */ ,
|
||||||
(__v8df) __A,
|
(__v8df) __A,
|
||||||
(__v8df) __B,
|
(__v8df) __B,
|
||||||
(__mmask8) __U);
|
(__mmask8) __U);
|
||||||
|
}
|
||||||
|
|
||||||
|
static __inline __m512 __DEFAULT_FN_ATTRS
|
||||||
|
_mm512_permutex2var_ps(__m512 __A, __m512i __I, __m512 __B)
|
||||||
|
{
|
||||||
|
return (__m512) __builtin_ia32_vpermt2varps512_mask ((__v16si) __I
|
||||||
|
/* idx */ ,
|
||||||
|
(__v16sf) __A,
|
||||||
|
(__v16sf) __B,
|
||||||
|
(__mmask16) -1);
|
||||||
|
}
|
||||||
|
|
||||||
|
static __inline__ __m512 __DEFAULT_FN_ATTRS
|
||||||
|
_mm512_mask_permutex2var_ps (__m512 __A, __mmask16 __U, __m512i __I, __m512 __B)
|
||||||
|
{
|
||||||
|
return (__m512) __builtin_ia32_vpermt2varps512_mask ((__v16si) __I
|
||||||
|
/* idx */ ,
|
||||||
|
(__v16sf) __A,
|
||||||
|
(__v16sf) __B,
|
||||||
|
(__mmask16) __U);
|
||||||
}
|
}
|
||||||
|
|
||||||
static __inline__ __m512 __DEFAULT_FN_ATTRS
|
static __inline__ __m512 __DEFAULT_FN_ATTRS
|
||||||
|
@ -5930,21 +6000,10 @@ _mm512_maskz_permutex2var_ps (__mmask16 __U, __m512 __A, __m512i __I,
|
||||||
__m512 __B)
|
__m512 __B)
|
||||||
{
|
{
|
||||||
return (__m512) __builtin_ia32_vpermt2varps512_maskz ((__v16si) __I
|
return (__m512) __builtin_ia32_vpermt2varps512_maskz ((__v16si) __I
|
||||||
/* idx */ ,
|
/* idx */ ,
|
||||||
(__v16sf) __A,
|
(__v16sf) __A,
|
||||||
(__v16sf) __B,
|
(__v16sf) __B,
|
||||||
(__mmask16) __U);
|
(__mmask16) __U);
|
||||||
}
|
|
||||||
|
|
||||||
static __inline__ __m512i __DEFAULT_FN_ATTRS
|
|
||||||
_mm512_maskz_permutex2var_epi64 (__mmask8 __U, __m512i __A,
|
|
||||||
__m512i __I, __m512i __B)
|
|
||||||
{
|
|
||||||
return (__m512i) __builtin_ia32_vpermt2varq512_maskz ((__v8di) __I
|
|
||||||
/* idx */ ,
|
|
||||||
(__v8di) __A,
|
|
||||||
(__v8di) __B,
|
|
||||||
(__mmask8) __U);
|
|
||||||
}
|
}
|
||||||
|
|
||||||
static __inline__ __mmask16 __DEFAULT_FN_ATTRS
|
static __inline__ __mmask16 __DEFAULT_FN_ATTRS
|
||||||
|
|
|
@ -3109,18 +3109,59 @@ __m512i test_mm512_maskz_permutex2var_epi32(__mmask16 __U, __m512i __A, __m512i
|
||||||
return _mm512_maskz_permutex2var_epi32(__U, __A, __I, __B);
|
return _mm512_maskz_permutex2var_epi32(__U, __A, __I, __B);
|
||||||
}
|
}
|
||||||
|
|
||||||
|
__m512i test_mm512_mask_permutex2var_epi32 (__m512i __A, __mmask16 __U, __m512i __I, __m512i __B)
|
||||||
|
{
|
||||||
|
// CHECK-LABEL: @test_mm512_mask_permutex2var_epi32
|
||||||
|
// CHECK: @llvm.x86.avx512.mask.vpermt2var.d.512
|
||||||
|
return _mm512_mask_permutex2var_epi32 (__A,__U,__I,__B);
|
||||||
|
}
|
||||||
|
|
||||||
|
__m512d test_mm512_permutex2var_pd (__m512d __A, __m512i __I, __m512d __B)
|
||||||
|
{
|
||||||
|
// CHECK-LABEL: @test_mm512_permutex2var_pd
|
||||||
|
// CHECK: @llvm.x86.avx512.mask.vpermt2var.pd.512
|
||||||
|
return _mm512_permutex2var_pd (__A, __I,__B);
|
||||||
|
}
|
||||||
|
|
||||||
|
__m512d test_mm512_mask_permutex2var_pd (__m512d __A, __mmask8 __U, __m512i __I, __m512d __B)
|
||||||
|
{
|
||||||
|
// CHECK-LABEL: @test_mm512_mask_permutex2var_pd
|
||||||
|
// CHECK: @llvm.x86.avx512.mask.vpermt2var.pd.512
|
||||||
|
return _mm512_mask_permutex2var_pd (__A,__U,__I,__B);
|
||||||
|
}
|
||||||
|
|
||||||
__m512d test_mm512_maskz_permutex2var_pd(__mmask8 __U, __m512d __A, __m512i __I, __m512d __B) {
|
__m512d test_mm512_maskz_permutex2var_pd(__mmask8 __U, __m512d __A, __m512i __I, __m512d __B) {
|
||||||
// CHECK-LABEL: @test_mm512_maskz_permutex2var_pd
|
// CHECK-LABEL: @test_mm512_maskz_permutex2var_pd
|
||||||
// CHECK: @llvm.x86.avx512.maskz.vpermt2var.pd.512
|
// CHECK: @llvm.x86.avx512.maskz.vpermt2var.pd.512
|
||||||
return _mm512_maskz_permutex2var_pd(__U, __A, __I, __B);
|
return _mm512_maskz_permutex2var_pd(__U, __A, __I, __B);
|
||||||
}
|
}
|
||||||
|
|
||||||
|
__m512 test_mm512_permutex2var_ps (__m512 __A, __m512i __I, __m512 __B)
|
||||||
|
{
|
||||||
|
// CHECK-LABEL: @test_mm512_permutex2var_ps
|
||||||
|
// CHECK: @llvm.x86.avx512.mask.vpermt2var.ps.512
|
||||||
|
return _mm512_permutex2var_ps (__A, __I, __B);
|
||||||
|
}
|
||||||
|
|
||||||
|
__m512 test_mm512_mask_permutex2var_ps (__m512 __A, __mmask16 __U, __m512i __I, __m512 __B)
|
||||||
|
{
|
||||||
|
// CHECK-LABEL: @test_mm512_mask_permutex2var_ps
|
||||||
|
// CHECK: @llvm.x86.avx512.mask.vpermt2var.ps.512
|
||||||
|
return _mm512_mask_permutex2var_ps (__A,__U,__I,__B);
|
||||||
|
}
|
||||||
|
|
||||||
__m512 test_mm512_maskz_permutex2var_ps(__mmask16 __U, __m512 __A, __m512i __I, __m512 __B) {
|
__m512 test_mm512_maskz_permutex2var_ps(__mmask16 __U, __m512 __A, __m512i __I, __m512 __B) {
|
||||||
// CHECK-LABEL: @test_mm512_maskz_permutex2var_ps
|
// CHECK-LABEL: @test_mm512_maskz_permutex2var_ps
|
||||||
// CHECK: @llvm.x86.avx512.maskz.vpermt2var.ps.512
|
// CHECK: @llvm.x86.avx512.maskz.vpermt2var.ps.512
|
||||||
return _mm512_maskz_permutex2var_ps(__U, __A, __I, __B);
|
return _mm512_maskz_permutex2var_ps(__U, __A, __I, __B);
|
||||||
}
|
}
|
||||||
|
|
||||||
|
__m512i test_mm512_mask_permutex2var_epi64 (__m512i __A, __mmask8 __U, __m512i __I, __m512i __B){
|
||||||
|
// CHECK-LABEL: @test_mm512_mask_permutex2var_epi64
|
||||||
|
// CHECK: @llvm.x86.avx512.mask.vpermt2var.q.512
|
||||||
|
return _mm512_mask_permutex2var_epi64(__A, __U, __I, __B);
|
||||||
|
}
|
||||||
|
|
||||||
__m512i test_mm512_maskz_permutex2var_epi64(__mmask8 __U, __m512i __A, __m512i __I, __m512i __B) {
|
__m512i test_mm512_maskz_permutex2var_epi64(__mmask8 __U, __m512i __A, __m512i __I, __m512i __B) {
|
||||||
// CHECK-LABEL: @test_mm512_maskz_permutex2var_epi64
|
// CHECK-LABEL: @test_mm512_maskz_permutex2var_epi64
|
||||||
// CHECK: @llvm.x86.avx512.maskz.vpermt2var.q.512
|
// CHECK: @llvm.x86.avx512.maskz.vpermt2var.q.512
|
||||||
|
@ -3149,6 +3190,21 @@ __mmask8 test_mm512_mask_testn_epi64_mask(__mmask8 __U, __m512i __A, __m512i __B
|
||||||
// CHECK: @llvm.x86.avx512.ptestnm.q.512
|
// CHECK: @llvm.x86.avx512.ptestnm.q.512
|
||||||
return _mm512_mask_testn_epi64_mask(__U, __A, __B);
|
return _mm512_mask_testn_epi64_mask(__U, __A, __B);
|
||||||
}
|
}
|
||||||
|
|
||||||
|
__mmask16 test_mm512_mask_test_epi32_mask (__mmask16 __U, __m512i __A, __m512i __B)
|
||||||
|
{
|
||||||
|
// CHECK-LABEL: @test_mm512_mask_test_epi32_mask
|
||||||
|
// CHECK: @llvm.x86.avx512.ptestm.d.512
|
||||||
|
return _mm512_mask_test_epi32_mask (__U,__A,__B);
|
||||||
|
}
|
||||||
|
|
||||||
|
__mmask8 test_mm512_mask_test_epi64_mask (__mmask8 __U, __m512i __A, __m512i __B)
|
||||||
|
{
|
||||||
|
// CHECK-LABEL: @test_mm512_mask_test_epi64_mask
|
||||||
|
// CHECK: @llvm.x86.avx512.ptestm.q.512
|
||||||
|
return _mm512_mask_test_epi64_mask (__U,__A,__B);
|
||||||
|
}
|
||||||
|
|
||||||
__m512i test_mm512_maskz_unpackhi_epi32(__mmask16 __U, __m512i __A, __m512i __B) {
|
__m512i test_mm512_maskz_unpackhi_epi32(__mmask16 __U, __m512i __A, __m512i __B) {
|
||||||
// CHECK-LABEL: @test_mm512_maskz_unpackhi_epi32
|
// CHECK-LABEL: @test_mm512_maskz_unpackhi_epi32
|
||||||
// CHECK: @llvm.x86.avx512.mask.punpckhd.q.512
|
// CHECK: @llvm.x86.avx512.mask.punpckhd.q.512
|
||||||
|
|
Loading…
Reference in New Issue