authorgravatar for andrew@ziglang.orgAndrew Kelley <andrew@ziglang.org> 2023-01-26 13:15:35-07:00
committergravatar for andrew@ziglang.orgAndrew Kelley <andrew@ziglang.org> 2023-01-26 16:36:13-07:00
log85be0b8c6589f58d5667d0a8a8f94524d5de5ba6
tree30aaa511ff01f908a867a2e43c1f6d1df7110a9c
parentb260bf42d3cadc12e814220b80fe9b41eeccb345

update C headers to LLVM 16

upstream commit 0604154e006e88e9e7f82d8ee5fd076bda206613

59 files changed, 37368 insertions(+), 35053 deletions(-)

lib/include/__clang_cuda_texture_intrinsics.h+2
......@@ -666,6 +666,7 @@ __device__ static void __tex_fetch(__T *__ptr, cudaTextureObject_t __handle,
666666 __tex_fetch_v4<__op>::template __run<__FetchT>(__handle, __args...));
667667}
668668
669#if CUDA_VERSION < 12000
669670// texture<> objects get magically converted into a texture reference. However,
670671// there's no way to convert them to cudaTextureObject_t on C++ level. So, we
671672// cheat a bit and use inline assembly to do it. It costs us an extra register
......@@ -713,6 +714,7 @@ __tex_fetch(__DataT *, __RetT *__ptr,
713714 __tex_fetch_v4<__op>::template __run<__FetchT>(
714715 __tex_handle_to_obj(__handle), __args...));
715716}
717#endif // CUDA_VERSION
716718} // namespace __cuda_tex
717719} // namespace
718720#pragma pop_macro("__ASM_OUT")
lib/include/__clang_hip_libdevice_declares.h+5
......@@ -288,12 +288,17 @@ __llvm_amdgcn_rsq_f64(double __x) {
288288
289289__device__ __attribute__((const)) _Float16 __ocml_ceil_f16(_Float16);
290290__device__ _Float16 __ocml_cos_f16(_Float16);
291__device__ __attribute__((const)) _Float16 __ocml_cvtrtn_f16_f32(float);
292__device__ __attribute__((const)) _Float16 __ocml_cvtrtp_f16_f32(float);
293__device__ __attribute__((const)) _Float16 __ocml_cvtrtz_f16_f32(float);
291294__device__ __attribute__((pure)) _Float16 __ocml_exp_f16(_Float16);
292295__device__ __attribute__((pure)) _Float16 __ocml_exp10_f16(_Float16);
293296__device__ __attribute__((pure)) _Float16 __ocml_exp2_f16(_Float16);
294297__device__ __attribute__((const)) _Float16 __ocml_floor_f16(_Float16);
295298__device__ __attribute__((const)) _Float16 __ocml_fma_f16(_Float16, _Float16,
296299 _Float16);
300__device__ __attribute__((const)) _Float16 __ocml_fmax_f16(_Float16, _Float16);
301__device__ __attribute__((const)) _Float16 __ocml_fmin_f16(_Float16, _Float16);
297302__device__ __attribute__((const)) _Float16 __ocml_fabs_f16(_Float16);
298303__device__ __attribute__((const)) int __ocml_isinf_f16(_Float16);
299304__device__ __attribute__((const)) int __ocml_isnan_f16(_Float16);
lib/include/__clang_hip_math.h+10-13
......@@ -70,9 +70,9 @@ __DEVICE__ void __static_assert_equal_size() {
7070#endif
7171
7272__DEVICE__
73uint64_t __make_mantissa_base8(const char *__tagp) {
73uint64_t __make_mantissa_base8(const char *__tagp __attribute__((nonnull))) {
7474 uint64_t __r = 0;
75 while (__tagp) {
75 while (*__tagp != '\0') {
7676 char __tmp = *__tagp;
7777
7878 if (__tmp >= '0' && __tmp <= '7')
......@@ -87,9 +87,9 @@ uint64_t __make_mantissa_base8(const char *__tagp) {
8787}
8888
8989__DEVICE__
90uint64_t __make_mantissa_base10(const char *__tagp) {
90uint64_t __make_mantissa_base10(const char *__tagp __attribute__((nonnull))) {
9191 uint64_t __r = 0;
92 while (__tagp) {
92 while (*__tagp != '\0') {
9393 char __tmp = *__tagp;
9494
9595 if (__tmp >= '0' && __tmp <= '9')
......@@ -104,9 +104,9 @@ uint64_t __make_mantissa_base10(const char *__tagp) {
104104}
105105
106106__DEVICE__
107uint64_t __make_mantissa_base16(const char *__tagp) {
107uint64_t __make_mantissa_base16(const char *__tagp __attribute__((nonnull))) {
108108 uint64_t __r = 0;
109 while (__tagp) {
109 while (*__tagp != '\0') {
110110 char __tmp = *__tagp;
111111
112112 if (__tmp >= '0' && __tmp <= '9')
......@@ -125,10 +125,7 @@ uint64_t __make_mantissa_base16(const char *__tagp) {
125125}
126126
127127__DEVICE__
128uint64_t __make_mantissa(const char *__tagp) {
129 if (!__tagp)
130 return 0u;
131
128uint64_t __make_mantissa(const char *__tagp __attribute__((nonnull))) {
132129 if (*__tagp == '0') {
133130 ++__tagp;
134131
......@@ -233,7 +230,7 @@ __DEVICE__
233230float expm1f(float __x) { return __ocml_expm1_f32(__x); }
234231
235232__DEVICE__
236float fabsf(float __x) { return __ocml_fabs_f32(__x); }
233float fabsf(float __x) { return __builtin_fabsf(__x); }
237234
238235__DEVICE__
239236float fdimf(float __x, float __y) { return __ocml_fdim_f32(__x, __y); }
......@@ -359,7 +356,7 @@ float modff(float __x, float *__iptr) {
359356}
360357
361358__DEVICE__
362float nanf(const char *__tagp) {
359float nanf(const char *__tagp __attribute__((nonnull))) {
363360 union {
364361 float val;
365362 struct ieee_float {
......@@ -792,7 +789,7 @@ __DEVICE__
792789double expm1(double __x) { return __ocml_expm1_f64(__x); }
793790
794791__DEVICE__
795double fabs(double __x) { return __ocml_fabs_f64(__x); }
792double fabs(double __x) { return __builtin_fabs(__x); }
796793
797794__DEVICE__
798795double fdim(double __x, double __y) { return __ocml_fdim_f64(__x, __y); }
lib/include/__clang_hip_runtime_wrapper.h+1
......@@ -113,6 +113,7 @@ __attribute__((weak)) inline __device__ void free(void *__ptr) {
113113
114114#include <__clang_hip_libdevice_declares.h>
115115#include <__clang_hip_math.h>
116#include <__clang_hip_stdlib.h>
116117
117118#if defined(__HIPCC_RTC__)
118119#include <__clang_hip_cmath.h>
lib/include/__clang_hip_stdlib.h created+43
......@@ -0,0 +1,43 @@
1/*===---- __clang_hip_stdlib.h - Device-side HIP math support --------------===
2 *
3 * Part of the LLVM Project, under the Apache License v2.0 with LLVM Exceptions.
4 * See https://llvm.org/LICENSE.txt for license information.
5 * SPDX-License-Identifier: Apache-2.0 WITH LLVM-exception
6 *
7 *===-----------------------------------------------------------------------===
8 */
9#ifndef __CLANG_HIP_STDLIB_H__
10
11#if !defined(__HIP__) && !defined(__OPENMP_AMDGCN__)
12#error "This file is for HIP and OpenMP AMDGCN device compilation only."
13#endif
14
15#if !defined(__cplusplus)
16
17#include <limits.h>
18
19#ifdef __OPENMP_AMDGCN__
20#define __DEVICE__ static inline __attribute__((always_inline, nothrow))
21#else
22#define __DEVICE__ static __device__ inline __attribute__((always_inline))
23#endif
24
25__DEVICE__
26int abs(int __x) {
27 int __sgn = __x >> (sizeof(int) * CHAR_BIT - 1);
28 return (__x ^ __sgn) - __sgn;
29}
30__DEVICE__
31long labs(long __x) {
32 long __sgn = __x >> (sizeof(long) * CHAR_BIT - 1);
33 return (__x ^ __sgn) - __sgn;
34}
35__DEVICE__
36long long llabs(long long __x) {
37 long long __sgn = __x >> (sizeof(long long) * CHAR_BIT - 1);
38 return (__x ^ __sgn) - __sgn;
39}
40
41#endif // !defined(__cplusplus)
42
43#endif // #define __CLANG_HIP_STDLIB_H__
lib/include/altivec.h+14-14
......@@ -17323,32 +17323,32 @@ provided.
1732317323#define vec_ncipherlast_be __builtin_altivec_crypto_vncipherlast
1732417324
1732517325#ifdef __VSX__
17326static __inline__ vector unsigned long long __attribute__((__always_inline__))
17327__builtin_crypto_vsbox(vector unsigned long long __a) {
17326static __inline__ vector unsigned char __attribute__((__always_inline__))
17327__builtin_crypto_vsbox(vector unsigned char __a) {
1732817328 return __builtin_altivec_crypto_vsbox(__a);
1732917329}
1733017330
17331static __inline__ vector unsigned long long __attribute__((__always_inline__))
17332__builtin_crypto_vcipher(vector unsigned long long __a,
17333 vector unsigned long long __b) {
17331static __inline__ vector unsigned char __attribute__((__always_inline__))
17332__builtin_crypto_vcipher(vector unsigned char __a,
17333 vector unsigned char __b) {
1733417334 return __builtin_altivec_crypto_vcipher(__a, __b);
1733517335}
1733617336
17337static __inline__ vector unsigned long long __attribute__((__always_inline__))
17338__builtin_crypto_vcipherlast(vector unsigned long long __a,
17339 vector unsigned long long __b) {
17337static __inline__ vector unsigned char __attribute__((__always_inline__))
17338__builtin_crypto_vcipherlast(vector unsigned char __a,
17339 vector unsigned char __b) {
1734017340 return __builtin_altivec_crypto_vcipherlast(__a, __b);
1734117341}
1734217342
17343static __inline__ vector unsigned long long __attribute__((__always_inline__))
17344__builtin_crypto_vncipher(vector unsigned long long __a,
17345 vector unsigned long long __b) {
17343static __inline__ vector unsigned char __attribute__((__always_inline__))
17344__builtin_crypto_vncipher(vector unsigned char __a,
17345 vector unsigned char __b) {
1734617346 return __builtin_altivec_crypto_vncipher(__a, __b);
1734717347}
1734817348
17349static __inline__ vector unsigned long long __attribute__((__always_inline__))
17350__builtin_crypto_vncipherlast(vector unsigned long long __a,
17351 vector unsigned long long __b) {
17349static __inline__ vector unsigned char __attribute__((__always_inline__))
17350__builtin_crypto_vncipherlast(vector unsigned char __a,
17351 vector unsigned char __b) {
1735217352 return __builtin_altivec_crypto_vncipherlast(__a, __b);
1735317353}
1735417354#endif /* __VSX__ */
lib/include/amxfp16intrin.h created+58
......@@ -0,0 +1,58 @@
1/*===------------- amxfp16intrin.h - AMX_FP16 intrinsics -*- C++ -*---------===
2 *
3 * Part of the LLVM Project, under the Apache License v2.0 with LLVM Exceptions.
4 * See https://llvm.org/LICENSE.txt for license information.
5 * SPDX-License-Identifier: Apache-2.0 WITH LLVM-exception
6 *
7 *===------------------------------------------------------------------------===
8 */
9
10#ifndef __IMMINTRIN_H
11#error "Never use <amxfp16intrin.h> directly; use <immintrin.h> instead."
12#endif /* __IMMINTRIN_H */
13
14#ifndef __AMX_FP16INTRIN_H
15#define __AMX_FP16INTRIN_H
16#ifdef __x86_64__
17
18/// Compute dot-product of FP16 (16-bit) floating-point pairs in tiles \a a
19/// and \a b, accumulating the intermediate single-precision (32-bit)
20/// floating-point elements with elements in \a dst, and store the 32-bit
21/// result back to tile \a dst.
22///
23/// \headerfile <immintrin.h>
24///
25/// \code
26/// void _tile_dpfp16ps (__tile dst, __tile a, __tile b)
27/// \endcode
28///
29/// \code{.operation}
30/// FOR m := 0 TO dst.rows - 1
31/// tmp := dst.row[m]
32/// FOR k := 0 TO (a.colsb / 4) - 1
33/// FOR n := 0 TO (dst.colsb / 4) - 1
34/// tmp.fp32[n] += FP32(a.row[m].fp16[2*k+0]) *
35/// FP32(b.row[k].fp16[2*n+0])
36/// tmp.fp32[n] += FP32(a.row[m].fp16[2*k+1]) *
37/// FP32(b.row[k].fp16[2*n+1])
38/// ENDFOR
39/// ENDFOR
40/// write_row_and_zero(dst, m, tmp, dst.colsb)
41/// ENDFOR
42/// zero_upper_rows(dst, dst.rows)
43/// zero_tileconfig_start()
44/// \endcode
45///
46/// This intrinsic corresponds to the \c TDPFP16PS instruction.
47///
48/// \param dst
49/// The destination tile. Max size is 1024 Bytes.
50/// \param a
51/// The 1st source tile. Max size is 1024 Bytes.
52/// \param b
53/// The 2nd source tile. Max size is 1024 Bytes.
54#define _tile_dpfp16ps(dst, a, b) \
55 __builtin_ia32_tdpfp16ps(dst, a, b)
56
57#endif /* __x86_64__ */
58#endif /* __AMX_FP16INTRIN_H */
lib/include/amxintrin.h+32
......@@ -22,6 +22,8 @@
2222 __attribute__((__always_inline__, __nodebug__, __target__("amx-int8")))
2323#define __DEFAULT_FN_ATTRS_BF16 \
2424 __attribute__((__always_inline__, __nodebug__, __target__("amx-bf16")))
25#define __DEFAULT_FN_ATTRS_FP16 \
26 __attribute__((__always_inline__, __nodebug__, __target__("amx-fp16")))
2527
2628/// Load tile configuration from a 64-byte memory location specified by
2729/// "mem_addr". The tile configuration includes the tile type palette, the
......@@ -290,6 +292,13 @@ _tile_dpbf16ps_internal(unsigned short m, unsigned short n, unsigned short k,
290292 return __builtin_ia32_tdpbf16ps_internal(m, n, k, dst, src1, src2);
291293}
292294
295/// This is internal intrinsic. C/C++ user should avoid calling it directly.
296static __inline__ _tile1024i __DEFAULT_FN_ATTRS_FP16
297_tile_dpfp16ps_internal(unsigned short m, unsigned short n, unsigned short k,
298 _tile1024i dst, _tile1024i src1, _tile1024i src2) {
299 return __builtin_ia32_tdpfp16ps_internal(m, n, k, dst, src1, src2);
300}
301
293302/// This struct pack the shape and tile data together for user. We suggest
294303/// initializing the struct as early as possible, because compiler depends
295304/// on the shape information to do configure. The constant value is preferred
......@@ -484,9 +493,32 @@ static __inline__ void __tile_dpbf16ps(__tile1024i *dst, __tile1024i src0,
484493 src0.tile, src1.tile);
485494}
486495
496/// Compute dot-product of FP16 (16-bit) floating-point pairs in tiles src0 and
497/// src1, accumulating the intermediate single-precision (32-bit) floating-point
498/// elements with elements in "dst", and store the 32-bit result back to tile
499/// "dst".
500///
501/// \headerfile <immintrin.h>
502///
503/// This intrinsic corresponds to the <c> TDPFP16PS </c> instruction.
504///
505/// \param dst
506/// The destination tile. Max size is 1024 Bytes.
507/// \param src0
508/// The 1st source tile. Max size is 1024 Bytes.
509/// \param src1
510/// The 2nd source tile. Max size is 1024 Bytes.
511__DEFAULT_FN_ATTRS_FP16
512static __inline__ void __tile_dpfp16ps(__tile1024i *dst, __tile1024i src0,
513 __tile1024i src1) {
514 dst->tile = _tile_dpfp16ps_internal(src0.row, src1.col, src0.col, dst->tile,
515 src0.tile, src1.tile);
516}
517
487518#undef __DEFAULT_FN_ATTRS_TILE
488519#undef __DEFAULT_FN_ATTRS_INT8
489520#undef __DEFAULT_FN_ATTRS_BF16
521#undef __DEFAULT_FN_ATTRS_FP16
490522
491523#endif /* __x86_64__ */
492524#endif /* __AMXINTRIN_H */
lib/include/arm_acle.h+76-75
......@@ -64,7 +64,7 @@ static __inline__ void __attribute__((__always_inline__, __nodebug__)) __yield(v
6464}
6565#endif
6666
67#if __ARM_32BIT_STATE
67#if defined(__ARM_32BIT_STATE) && __ARM_32BIT_STATE
6868#define __dbg(t) __builtin_arm_dbg(t)
6969#endif
7070
......@@ -82,7 +82,7 @@ __swp(uint32_t __x, volatile uint32_t *__p) {
8282/* 8.6.1 Data prefetch */
8383#define __pld(addr) __pldx(0, 0, 0, addr)
8484
85#if __ARM_32BIT_STATE
85#if defined(__ARM_32BIT_STATE) && __ARM_32BIT_STATE
8686#define __pldx(access_kind, cache_level, retention_policy, addr) \
8787 __builtin_arm_prefetch(addr, access_kind, 1)
8888#else
......@@ -93,7 +93,7 @@ __swp(uint32_t __x, volatile uint32_t *__p) {
9393/* 8.6.2 Instruction prefetch */
9494#define __pli(addr) __plix(0, 0, addr)
9595
96#if __ARM_32BIT_STATE
96#if defined(__ARM_32BIT_STATE) && __ARM_32BIT_STATE
9797#define __plix(cache_level, retention_policy, addr) \
9898 __builtin_arm_prefetch(addr, 0, 0)
9999#else
......@@ -140,17 +140,17 @@ __rorl(unsigned long __x, uint32_t __y) {
140140/* CLZ */
141141static __inline__ uint32_t __attribute__((__always_inline__, __nodebug__))
142142__clz(uint32_t __t) {
143 return __builtin_clz(__t);
143 return (uint32_t)__builtin_clz(__t);
144144}
145145
146146static __inline__ unsigned long __attribute__((__always_inline__, __nodebug__))
147147__clzl(unsigned long __t) {
148 return __builtin_clzl(__t);
148 return (unsigned long)__builtin_clzl(__t);
149149}
150150
151151static __inline__ uint64_t __attribute__((__always_inline__, __nodebug__))
152152__clzll(uint64_t __t) {
153 return __builtin_clzll(__t);
153 return (uint64_t)__builtin_clzll(__t);
154154}
155155
156156/* CLS */
......@@ -201,7 +201,7 @@ __rev16(uint32_t __t) {
201201
202202static __inline__ uint64_t __attribute__((__always_inline__, __nodebug__))
203203__rev16ll(uint64_t __t) {
204 return (((uint64_t)__rev16(__t >> 32)) << 32) | __rev16(__t);
204 return (((uint64_t)__rev16(__t >> 32)) << 32) | (uint64_t)__rev16((uint32_t)__t);
205205}
206206
207207static __inline__ unsigned long __attribute__((__always_inline__, __nodebug__))
......@@ -216,7 +216,7 @@ __rev16l(unsigned long __t) {
216216/* REVSH */
217217static __inline__ int16_t __attribute__((__always_inline__, __nodebug__))
218218__revsh(int16_t __t) {
219 return __builtin_bswap16(__t);
219 return (int16_t)__builtin_bswap16((uint16_t)__t);
220220}
221221
222222/* RBIT */
......@@ -227,7 +227,7 @@ __rbit(uint32_t __t) {
227227
228228static __inline__ uint64_t __attribute__((__always_inline__, __nodebug__))
229229__rbitll(uint64_t __t) {
230#if __ARM_32BIT_STATE
230#if defined(__ARM_32BIT_STATE) && __ARM_32BIT_STATE
231231 return (((uint64_t)__builtin_arm_rbit(__t)) << 32) |
232232 __builtin_arm_rbit(__t >> 32);
233233#else
......@@ -247,7 +247,7 @@ __rbitl(unsigned long __t) {
247247/*
248248 * 9.3 16-bit multiplications
249249 */
250#if __ARM_FEATURE_DSP
250#if defined(__ARM_FEATURE_DSP) && __ARM_FEATURE_DSP
251251static __inline__ int32_t __attribute__((__always_inline__,__nodebug__))
252252__smulbb(int32_t __a, int32_t __b) {
253253 return __builtin_arm_smulbb(__a, __b);
......@@ -277,17 +277,17 @@ __smulwt(int32_t __a, int32_t __b) {
277277/*
278278 * 9.4 Saturating intrinsics
279279 *
280 * FIXME: Change guard to their corrosponding __ARM_FEATURE flag when Q flag
280 * FIXME: Change guard to their corresponding __ARM_FEATURE flag when Q flag
281281 * intrinsics are implemented and the flag is enabled.
282282 */
283283/* 9.4.1 Width-specified saturation intrinsics */
284#if __ARM_FEATURE_SAT
284#if defined(__ARM_FEATURE_SAT) && __ARM_FEATURE_SAT
285285#define __ssat(x, y) __builtin_arm_ssat(x, y)
286286#define __usat(x, y) __builtin_arm_usat(x, y)
287287#endif
288288
289289/* 9.4.2 Saturating addition and subtraction intrinsics */
290#if __ARM_FEATURE_DSP
290#if defined(__ARM_FEATURE_DSP) && __ARM_FEATURE_DSP
291291static __inline__ int32_t __attribute__((__always_inline__, __nodebug__))
292292__qadd(int32_t __t, int32_t __v) {
293293 return __builtin_arm_qadd(__t, __v);
......@@ -305,7 +305,7 @@ __qdbl(int32_t __t) {
305305#endif
306306
307307/* 9.4.3 Accumultating multiplications */
308#if __ARM_FEATURE_DSP
308#if defined(__ARM_FEATURE_DSP) && __ARM_FEATURE_DSP
309309static __inline__ int32_t __attribute__((__always_inline__, __nodebug__))
310310__smlabb(int32_t __a, int32_t __b, int32_t __c) {
311311 return __builtin_arm_smlabb(__a, __b, __c);
......@@ -334,13 +334,13 @@ __smlawt(int32_t __a, int32_t __b, int32_t __c) {
334334
335335
336336/* 9.5.4 Parallel 16-bit saturation */
337#if __ARM_FEATURE_SIMD32
337#if defined(__ARM_FEATURE_SIMD32) && __ARM_FEATURE_SIMD32
338338#define __ssat16(x, y) __builtin_arm_ssat16(x, y)
339339#define __usat16(x, y) __builtin_arm_usat16(x, y)
340340#endif
341341
342342/* 9.5.5 Packing and unpacking */
343#if __ARM_FEATURE_SIMD32
343#if defined(__ARM_FEATURE_SIMD32) && __ARM_FEATURE_SIMD32
344344typedef int32_t int8x4_t;
345345typedef int32_t int16x2_t;
346346typedef uint32_t uint8x4_t;
......@@ -365,7 +365,7 @@ __uxtb16(int8x4_t __a) {
365365#endif
366366
367367/* 9.5.6 Parallel selection */
368#if __ARM_FEATURE_SIMD32
368#if defined(__ARM_FEATURE_SIMD32) && __ARM_FEATURE_SIMD32
369369static __inline__ uint8x4_t __attribute__((__always_inline__, __nodebug__))
370370__sel(uint8x4_t __a, uint8x4_t __b) {
371371 return __builtin_arm_sel(__a, __b);
......@@ -373,7 +373,7 @@ __sel(uint8x4_t __a, uint8x4_t __b) {
373373#endif
374374
375375/* 9.5.7 Parallel 8-bit addition and subtraction */
376#if __ARM_FEATURE_SIMD32
376#if defined(__ARM_FEATURE_SIMD32) && __ARM_FEATURE_SIMD32
377377static __inline__ int8x4_t __attribute__((__always_inline__, __nodebug__))
378378__qadd8(int8x4_t __a, int8x4_t __b) {
379379 return __builtin_arm_qadd8(__a, __b);
......@@ -425,7 +425,7 @@ __usub8(uint8x4_t __a, uint8x4_t __b) {
425425#endif
426426
427427/* 9.5.8 Sum of 8-bit absolute differences */
428#if __ARM_FEATURE_SIMD32
428#if defined(__ARM_FEATURE_SIMD32) && __ARM_FEATURE_SIMD32
429429static __inline__ uint32_t __attribute__((__always_inline__, __nodebug__))
430430__usad8(uint8x4_t __a, uint8x4_t __b) {
431431 return __builtin_arm_usad8(__a, __b);
......@@ -437,7 +437,7 @@ __usada8(uint8x4_t __a, uint8x4_t __b, uint32_t __c) {
437437#endif
438438
439439/* 9.5.9 Parallel 16-bit addition and subtraction */
440#if __ARM_FEATURE_SIMD32
440#if defined(__ARM_FEATURE_SIMD32) && __ARM_FEATURE_SIMD32
441441static __inline__ int16x2_t __attribute__((__always_inline__, __nodebug__))
442442__qadd16(int16x2_t __a, int16x2_t __b) {
443443 return __builtin_arm_qadd16(__a, __b);
......@@ -537,7 +537,7 @@ __usub16(uint16x2_t __a, uint16x2_t __b) {
537537#endif
538538
539539/* 9.5.10 Parallel 16-bit multiplications */
540#if __ARM_FEATURE_SIMD32
540#if defined(__ARM_FEATURE_SIMD32) && __ARM_FEATURE_SIMD32
541541static __inline__ int32_t __attribute__((__always_inline__, __nodebug__))
542542__smlad(int16x2_t __a, int16x2_t __b, int32_t __c) {
543543 return __builtin_arm_smlad(__a, __b, __c);
......@@ -589,155 +589,156 @@ __smusdx(int16x2_t __a, int16x2_t __b) {
589589#endif
590590
591591/* 9.7 CRC32 intrinsics */
592#if __ARM_FEATURE_CRC32
593static __inline__ uint32_t __attribute__((__always_inline__, __nodebug__))
592#if (defined(__ARM_FEATURE_CRC32) && __ARM_FEATURE_CRC32) || \
593 (defined(__ARM_64BIT_STATE) && __ARM_64BIT_STATE)
594static __inline__ uint32_t __attribute__((__always_inline__, __nodebug__, target("crc")))
594595__crc32b(uint32_t __a, uint8_t __b) {
595596 return __builtin_arm_crc32b(__a, __b);
596597}
597598
598static __inline__ uint32_t __attribute__((__always_inline__, __nodebug__))
599static __inline__ uint32_t __attribute__((__always_inline__, __nodebug__, target("crc")))
599600__crc32h(uint32_t __a, uint16_t __b) {
600601 return __builtin_arm_crc32h(__a, __b);
601602}
602603
603static __inline__ uint32_t __attribute__((__always_inline__, __nodebug__))
604static __inline__ uint32_t __attribute__((__always_inline__, __nodebug__, target("crc")))
604605__crc32w(uint32_t __a, uint32_t __b) {
605606 return __builtin_arm_crc32w(__a, __b);
606607}
607608
608static __inline__ uint32_t __attribute__((__always_inline__, __nodebug__))
609static __inline__ uint32_t __attribute__((__always_inline__, __nodebug__, target("crc")))
609610__crc32d(uint32_t __a, uint64_t __b) {
610611 return __builtin_arm_crc32d(__a, __b);
611612}
612613
613static __inline__ uint32_t __attribute__((__always_inline__, __nodebug__))
614static __inline__ uint32_t __attribute__((__always_inline__, __nodebug__, target("crc")))
614615__crc32cb(uint32_t __a, uint8_t __b) {
615616 return __builtin_arm_crc32cb(__a, __b);
616617}
617618
618static __inline__ uint32_t __attribute__((__always_inline__, __nodebug__))
619static __inline__ uint32_t __attribute__((__always_inline__, __nodebug__, target("crc")))
619620__crc32ch(uint32_t __a, uint16_t __b) {
620621 return __builtin_arm_crc32ch(__a, __b);
621622}
622623
623static __inline__ uint32_t __attribute__((__always_inline__, __nodebug__))
624static __inline__ uint32_t __attribute__((__always_inline__, __nodebug__, target("crc")))
624625__crc32cw(uint32_t __a, uint32_t __b) {
625626 return __builtin_arm_crc32cw(__a, __b);
626627}
627628
628static __inline__ uint32_t __attribute__((__always_inline__, __nodebug__))
629static __inline__ uint32_t __attribute__((__always_inline__, __nodebug__, target("crc")))
629630__crc32cd(uint32_t __a, uint64_t __b) {
630631 return __builtin_arm_crc32cd(__a, __b);
631632}
632633#endif
633634
634635/* Armv8.3-A Javascript conversion intrinsic */
635#if __ARM_64BIT_STATE && defined(__ARM_FEATURE_JCVT)
636static __inline__ int32_t __attribute__((__always_inline__, __nodebug__))
636#if defined(__ARM_64BIT_STATE) && __ARM_64BIT_STATE
637static __inline__ int32_t __attribute__((__always_inline__, __nodebug__, target("v8.3a")))
637638__jcvt(double __a) {
638639 return __builtin_arm_jcvt(__a);
639640}
640641#endif
641642
642643/* Armv8.5-A FP rounding intrinsics */
643#if __ARM_64BIT_STATE && defined(__ARM_FEATURE_FRINT)
644static __inline__ float __attribute__((__always_inline__, __nodebug__))
645__frint32zf(float __a) {
646 return __builtin_arm_frint32zf(__a);
644#if defined(__ARM_64BIT_STATE) && __ARM_64BIT_STATE
645static __inline__ float __attribute__((__always_inline__, __nodebug__, target("v8.5a")))
646__rint32zf(float __a) {
647 return __builtin_arm_rint32zf(__a);
647648}
648649
649static __inline__ double __attribute__((__always_inline__, __nodebug__))
650__frint32z(double __a) {
651 return __builtin_arm_frint32z(__a);
650static __inline__ double __attribute__((__always_inline__, __nodebug__, target("v8.5a")))
651__rint32z(double __a) {
652 return __builtin_arm_rint32z(__a);
652653}
653654
654static __inline__ float __attribute__((__always_inline__, __nodebug__))
655__frint64zf(float __a) {
656 return __builtin_arm_frint64zf(__a);
655static __inline__ float __attribute__((__always_inline__, __nodebug__, target("v8.5a")))
656__rint64zf(float __a) {
657 return __builtin_arm_rint64zf(__a);
657658}
658659
659static __inline__ double __attribute__((__always_inline__, __nodebug__))
660__frint64z(double __a) {
661 return __builtin_arm_frint64z(__a);
660static __inline__ double __attribute__((__always_inline__, __nodebug__, target("v8.5a")))
661__rint64z(double __a) {
662 return __builtin_arm_rint64z(__a);
662663}
663664
664static __inline__ float __attribute__((__always_inline__, __nodebug__))
665__frint32xf(float __a) {
666 return __builtin_arm_frint32xf(__a);
665static __inline__ float __attribute__((__always_inline__, __nodebug__, target("v8.5a")))
666__rint32xf(float __a) {
667 return __builtin_arm_rint32xf(__a);
667668}
668669
669static __inline__ double __attribute__((__always_inline__, __nodebug__))
670__frint32x(double __a) {
671 return __builtin_arm_frint32x(__a);
670static __inline__ double __attribute__((__always_inline__, __nodebug__, target("v8.5a")))
671__rint32x(double __a) {
672 return __builtin_arm_rint32x(__a);
672673}
673674
674static __inline__ float __attribute__((__always_inline__, __nodebug__))
675__frint64xf(float __a) {
676 return __builtin_arm_frint64xf(__a);
675static __inline__ float __attribute__((__always_inline__, __nodebug__, target("v8.5a")))
676__rint64xf(float __a) {
677 return __builtin_arm_rint64xf(__a);
677678}
678679
679static __inline__ double __attribute__((__always_inline__, __nodebug__))
680__frint64x(double __a) {
681 return __builtin_arm_frint64x(__a);
680static __inline__ double __attribute__((__always_inline__, __nodebug__, target("v8.5a")))
681__rint64x(double __a) {
682 return __builtin_arm_rint64x(__a);
682683}
683684#endif
684685
685686/* Armv8.7-A load/store 64-byte intrinsics */
686#if __ARM_64BIT_STATE && defined(__ARM_FEATURE_LS64)
687#if defined(__ARM_64BIT_STATE) && __ARM_64BIT_STATE
687688typedef struct {
688689 uint64_t val[8];
689690} data512_t;
690691
691static __inline__ data512_t __attribute__((__always_inline__, __nodebug__))
692static __inline__ data512_t __attribute__((__always_inline__, __nodebug__, target("ls64")))
692693__arm_ld64b(const void *__addr) {
693 data512_t __value;
694 __builtin_arm_ld64b(__addr, __value.val);
695 return __value;
694 data512_t __value;
695 __builtin_arm_ld64b(__addr, __value.val);
696 return __value;
696697}
697static __inline__ void __attribute__((__always_inline__, __nodebug__))
698static __inline__ void __attribute__((__always_inline__, __nodebug__, target("ls64")))
698699__arm_st64b(void *__addr, data512_t __value) {
699 __builtin_arm_st64b(__addr, __value.val);
700 __builtin_arm_st64b(__addr, __value.val);
700701}
701static __inline__ uint64_t __attribute__((__always_inline__, __nodebug__))
702static __inline__ uint64_t __attribute__((__always_inline__, __nodebug__, target("ls64")))
702703__arm_st64bv(void *__addr, data512_t __value) {
703 return __builtin_arm_st64bv(__addr, __value.val);
704 return __builtin_arm_st64bv(__addr, __value.val);
704705}
705static __inline__ uint64_t __attribute__((__always_inline__, __nodebug__))
706static __inline__ uint64_t __attribute__((__always_inline__, __nodebug__, target("ls64")))
706707__arm_st64bv0(void *__addr, data512_t __value) {
707 return __builtin_arm_st64bv0(__addr, __value.val);
708 return __builtin_arm_st64bv0(__addr, __value.val);
708709}
709710#endif
710711
711712/* 10.1 Special register intrinsics */
712713#define __arm_rsr(sysreg) __builtin_arm_rsr(sysreg)
713714#define __arm_rsr64(sysreg) __builtin_arm_rsr64(sysreg)
715#define __arm_rsr128(sysreg) __builtin_arm_rsr128(sysreg)
714716#define __arm_rsrp(sysreg) __builtin_arm_rsrp(sysreg)
715717#define __arm_rsrf(sysreg) __builtin_bit_cast(float, __arm_rsr(sysreg))
716718#define __arm_rsrf64(sysreg) __builtin_bit_cast(double, __arm_rsr64(sysreg))
717719#define __arm_wsr(sysreg, v) __builtin_arm_wsr(sysreg, v)
718720#define __arm_wsr64(sysreg, v) __builtin_arm_wsr64(sysreg, v)
721#define __arm_wsr128(sysreg, v) __builtin_arm_wsr128(sysreg, v)
719722#define __arm_wsrp(sysreg, v) __builtin_arm_wsrp(sysreg, v)
720723#define __arm_wsrf(sysreg, v) __arm_wsr(sysreg, __builtin_bit_cast(uint32_t, v))
721724#define __arm_wsrf64(sysreg, v) __arm_wsr64(sysreg, __builtin_bit_cast(uint64_t, v))
722725
723726/* Memory Tagging Extensions (MTE) Intrinsics */
724#if __ARM_FEATURE_MEMORY_TAGGING
727#if defined(__ARM_64BIT_STATE) && __ARM_64BIT_STATE
725728#define __arm_mte_create_random_tag(__ptr, __mask) __builtin_arm_irg(__ptr, __mask)
726729#define __arm_mte_increment_tag(__ptr, __tag_offset) __builtin_arm_addg(__ptr, __tag_offset)
727730#define __arm_mte_exclude_tag(__ptr, __excluded) __builtin_arm_gmi(__ptr, __excluded)
728731#define __arm_mte_get_tag(__ptr) __builtin_arm_ldg(__ptr)
729732#define __arm_mte_set_tag(__ptr) __builtin_arm_stg(__ptr)
730733#define __arm_mte_ptrdiff(__ptra, __ptrb) __builtin_arm_subp(__ptra, __ptrb)
731#endif
732734
733735/* Memory Operations Intrinsics */
734#if __ARM_FEATURE_MOPS && __ARM_FEATURE_MEMORY_TAGGING
735736#define __arm_mops_memset_tag(__tagged_address, __value, __size) \
736737 __builtin_arm_mops_memset_tag(__tagged_address, __value, __size)
737738#endif
738739
739740/* Transactional Memory Extension (TME) Intrinsics */
740#if __ARM_FEATURE_TME
741#if defined(__ARM_FEATURE_TME) && __ARM_FEATURE_TME
741742
742743#define _TMFAILURE_REASON 0x00007fffu
743744#define _TMFAILURE_RTRY 0x00008000u
......@@ -759,12 +760,12 @@ __arm_st64bv0(void *__addr, data512_t __value) {
759760#endif /* __ARM_FEATURE_TME */
760761
761762/* Armv8.5-A Random number generation intrinsics */
762#if __ARM_64BIT_STATE && defined(__ARM_FEATURE_RNG)
763static __inline__ int __attribute__((__always_inline__, __nodebug__))
763#if defined(__ARM_64BIT_STATE) && __ARM_64BIT_STATE
764static __inline__ int __attribute__((__always_inline__, __nodebug__, target("rand")))
764765__rndr(uint64_t *__p) {
765766 return __builtin_arm_rndr(__p);
766767}
767static __inline__ int __attribute__((__always_inline__, __nodebug__))
768static __inline__ int __attribute__((__always_inline__, __nodebug__, target("rand")))
768769__rndrrs(uint64_t *__p) {
769770 return __builtin_arm_rndrrs(__p);
770771}
lib/include/arm_fp16.h+1-1
......@@ -29,7 +29,7 @@
2929typedef __fp16 float16_t;
3030#define __ai static __inline__ __attribute__((__always_inline__, __nodebug__))
3131
32#if defined(__ARM_FEATURE_FP16_SCALAR_ARITHMETIC) && defined(__aarch64__)
32#if defined(__aarch64__)
3333#define vabdh_f16(__p0, __p1) __extension__ ({ \
3434 float16_t __ret; \
3535 float16_t __s0 = __p0; \
lib/include/arm_neon.h+26428-26598
......@@ -34,11 +34,8 @@
3434
3535#include <stdint.h>
3636
37#ifdef __ARM_FEATURE_BF16
3837#include <arm_bf16.h>
3938typedef __bf16 bfloat16_t;
40#endif
41
4239typedef float float32_t;
4340typedef __fp16 float16_t;
4441#ifdef __aarch64__
......@@ -428,7 +425,6 @@ typedef struct poly64x2x4_t {
428425 poly64x2_t val[4];
429426} poly64x2x4_t;
430427
431#ifdef __ARM_FEATURE_BF16
432428typedef __attribute__((neon_vector_type(4))) bfloat16_t bfloat16x4_t;
433429typedef __attribute__((neon_vector_type(8))) bfloat16_t bfloat16x8_t;
434430
......@@ -456,8 +452,6 @@ typedef struct bfloat16x8x4_t {
456452 bfloat16x8_t val[4];
457453} bfloat16x8x4_t;
458454
459#endif
460
461455#define __ai static __inline__ __attribute__((__always_inline__, __nodebug__))
462456
463457#ifdef __LITTLE_ENDIAN__
......@@ -6124,194 +6118,230 @@ __ai uint32x2_t vcvt_u32_f32(float32x2_t __p0) {
61246118#endif
61256119
61266120#ifdef __LITTLE_ENDIAN__
6127#define vdupq_lane_s32(__p0_20, __p1_20) __extension__ ({ \
6128 int32x4_t __ret_20; \
6129 int32x2_t __s0_20 = __p0_20; \
6130 __ret_20 = splatq_lane_s32(__s0_20, __p1_20); \
6121#define vdupq_lane_f16(__p0_20, __p1_20) __extension__ ({ \
6122 float16x8_t __ret_20; \
6123 float16x4_t __s0_20 = __p0_20; \
6124 __ret_20 = splatq_lane_f16(__s0_20, __p1_20); \
61316125 __ret_20; \
61326126})
61336127#else
6134#define vdupq_lane_s32(__p0_21, __p1_21) __extension__ ({ \
6135 int32x4_t __ret_21; \
6136 int32x2_t __s0_21 = __p0_21; \
6137 int32x2_t __rev0_21; __rev0_21 = __builtin_shufflevector(__s0_21, __s0_21, 1, 0); \
6138 __ret_21 = __noswap_splatq_lane_s32(__rev0_21, __p1_21); \
6139 __ret_21 = __builtin_shufflevector(__ret_21, __ret_21, 3, 2, 1, 0); \
6128#define vdupq_lane_f16(__p0_21, __p1_21) __extension__ ({ \
6129 float16x8_t __ret_21; \
6130 float16x4_t __s0_21 = __p0_21; \
6131 float16x4_t __rev0_21; __rev0_21 = __builtin_shufflevector(__s0_21, __s0_21, 3, 2, 1, 0); \
6132 __ret_21 = __noswap_splatq_lane_f16(__rev0_21, __p1_21); \
6133 __ret_21 = __builtin_shufflevector(__ret_21, __ret_21, 7, 6, 5, 4, 3, 2, 1, 0); \
61406134 __ret_21; \
61416135})
61426136#endif
61436137
61446138#ifdef __LITTLE_ENDIAN__
6145#define vdupq_lane_s64(__p0_22, __p1_22) __extension__ ({ \
6146 int64x2_t __ret_22; \
6147 int64x1_t __s0_22 = __p0_22; \
6148 __ret_22 = splatq_lane_s64(__s0_22, __p1_22); \
6139#define vdupq_lane_s32(__p0_22, __p1_22) __extension__ ({ \
6140 int32x4_t __ret_22; \
6141 int32x2_t __s0_22 = __p0_22; \
6142 __ret_22 = splatq_lane_s32(__s0_22, __p1_22); \
61496143 __ret_22; \
61506144})
61516145#else
6152#define vdupq_lane_s64(__p0_23, __p1_23) __extension__ ({ \
6153 int64x2_t __ret_23; \
6154 int64x1_t __s0_23 = __p0_23; \
6155 __ret_23 = __noswap_splatq_lane_s64(__s0_23, __p1_23); \
6156 __ret_23 = __builtin_shufflevector(__ret_23, __ret_23, 1, 0); \
6146#define vdupq_lane_s32(__p0_23, __p1_23) __extension__ ({ \
6147 int32x4_t __ret_23; \
6148 int32x2_t __s0_23 = __p0_23; \
6149 int32x2_t __rev0_23; __rev0_23 = __builtin_shufflevector(__s0_23, __s0_23, 1, 0); \
6150 __ret_23 = __noswap_splatq_lane_s32(__rev0_23, __p1_23); \
6151 __ret_23 = __builtin_shufflevector(__ret_23, __ret_23, 3, 2, 1, 0); \
61576152 __ret_23; \
61586153})
61596154#endif
61606155
61616156#ifdef __LITTLE_ENDIAN__
6162#define vdupq_lane_s16(__p0_24, __p1_24) __extension__ ({ \
6163 int16x8_t __ret_24; \
6164 int16x4_t __s0_24 = __p0_24; \
6165 __ret_24 = splatq_lane_s16(__s0_24, __p1_24); \
6157#define vdupq_lane_s64(__p0_24, __p1_24) __extension__ ({ \
6158 int64x2_t __ret_24; \
6159 int64x1_t __s0_24 = __p0_24; \
6160 __ret_24 = splatq_lane_s64(__s0_24, __p1_24); \
61666161 __ret_24; \
61676162})
61686163#else
6169#define vdupq_lane_s16(__p0_25, __p1_25) __extension__ ({ \
6170 int16x8_t __ret_25; \
6171 int16x4_t __s0_25 = __p0_25; \
6172 int16x4_t __rev0_25; __rev0_25 = __builtin_shufflevector(__s0_25, __s0_25, 3, 2, 1, 0); \
6173 __ret_25 = __noswap_splatq_lane_s16(__rev0_25, __p1_25); \
6174 __ret_25 = __builtin_shufflevector(__ret_25, __ret_25, 7, 6, 5, 4, 3, 2, 1, 0); \
6164#define vdupq_lane_s64(__p0_25, __p1_25) __extension__ ({ \
6165 int64x2_t __ret_25; \
6166 int64x1_t __s0_25 = __p0_25; \
6167 __ret_25 = __noswap_splatq_lane_s64(__s0_25, __p1_25); \
6168 __ret_25 = __builtin_shufflevector(__ret_25, __ret_25, 1, 0); \
61756169 __ret_25; \
61766170})
61776171#endif
61786172
61796173#ifdef __LITTLE_ENDIAN__
6180#define vdup_lane_u8(__p0_26, __p1_26) __extension__ ({ \
6181 uint8x8_t __ret_26; \
6182 uint8x8_t __s0_26 = __p0_26; \
6183 __ret_26 = splat_lane_u8(__s0_26, __p1_26); \
6174#define vdupq_lane_s16(__p0_26, __p1_26) __extension__ ({ \
6175 int16x8_t __ret_26; \
6176 int16x4_t __s0_26 = __p0_26; \
6177 __ret_26 = splatq_lane_s16(__s0_26, __p1_26); \
61846178 __ret_26; \
61856179})
61866180#else
6187#define vdup_lane_u8(__p0_27, __p1_27) __extension__ ({ \
6188 uint8x8_t __ret_27; \
6189 uint8x8_t __s0_27 = __p0_27; \
6190 uint8x8_t __rev0_27; __rev0_27 = __builtin_shufflevector(__s0_27, __s0_27, 7, 6, 5, 4, 3, 2, 1, 0); \
6191 __ret_27 = __noswap_splat_lane_u8(__rev0_27, __p1_27); \
6181#define vdupq_lane_s16(__p0_27, __p1_27) __extension__ ({ \
6182 int16x8_t __ret_27; \
6183 int16x4_t __s0_27 = __p0_27; \
6184 int16x4_t __rev0_27; __rev0_27 = __builtin_shufflevector(__s0_27, __s0_27, 3, 2, 1, 0); \
6185 __ret_27 = __noswap_splatq_lane_s16(__rev0_27, __p1_27); \
61926186 __ret_27 = __builtin_shufflevector(__ret_27, __ret_27, 7, 6, 5, 4, 3, 2, 1, 0); \
61936187 __ret_27; \
61946188})
61956189#endif
61966190
61976191#ifdef __LITTLE_ENDIAN__
6198#define vdup_lane_u32(__p0_28, __p1_28) __extension__ ({ \
6199 uint32x2_t __ret_28; \
6200 uint32x2_t __s0_28 = __p0_28; \
6201 __ret_28 = splat_lane_u32(__s0_28, __p1_28); \
6192#define vdup_lane_u8(__p0_28, __p1_28) __extension__ ({ \
6193 uint8x8_t __ret_28; \
6194 uint8x8_t __s0_28 = __p0_28; \
6195 __ret_28 = splat_lane_u8(__s0_28, __p1_28); \
62026196 __ret_28; \
62036197})
62046198#else
6205#define vdup_lane_u32(__p0_29, __p1_29) __extension__ ({ \
6206 uint32x2_t __ret_29; \
6207 uint32x2_t __s0_29 = __p0_29; \
6208 uint32x2_t __rev0_29; __rev0_29 = __builtin_shufflevector(__s0_29, __s0_29, 1, 0); \
6209 __ret_29 = __noswap_splat_lane_u32(__rev0_29, __p1_29); \
6210 __ret_29 = __builtin_shufflevector(__ret_29, __ret_29, 1, 0); \
6199#define vdup_lane_u8(__p0_29, __p1_29) __extension__ ({ \
6200 uint8x8_t __ret_29; \
6201 uint8x8_t __s0_29 = __p0_29; \
6202 uint8x8_t __rev0_29; __rev0_29 = __builtin_shufflevector(__s0_29, __s0_29, 7, 6, 5, 4, 3, 2, 1, 0); \
6203 __ret_29 = __noswap_splat_lane_u8(__rev0_29, __p1_29); \
6204 __ret_29 = __builtin_shufflevector(__ret_29, __ret_29, 7, 6, 5, 4, 3, 2, 1, 0); \
62116205 __ret_29; \
62126206})
62136207#endif
62146208
6215#define vdup_lane_u64(__p0_30, __p1_30) __extension__ ({ \
6216 uint64x1_t __ret_30; \
6217 uint64x1_t __s0_30 = __p0_30; \
6218 __ret_30 = splat_lane_u64(__s0_30, __p1_30); \
6219 __ret_30; \
6220})
62216209#ifdef __LITTLE_ENDIAN__
6222#define vdup_lane_u16(__p0_31, __p1_31) __extension__ ({ \
6223 uint16x4_t __ret_31; \
6224 uint16x4_t __s0_31 = __p0_31; \
6225 __ret_31 = splat_lane_u16(__s0_31, __p1_31); \
6226 __ret_31; \
6210#define vdup_lane_u32(__p0_30, __p1_30) __extension__ ({ \
6211 uint32x2_t __ret_30; \
6212 uint32x2_t __s0_30 = __p0_30; \
6213 __ret_30 = splat_lane_u32(__s0_30, __p1_30); \
6214 __ret_30; \
62276215})
62286216#else
6229#define vdup_lane_u16(__p0_32, __p1_32) __extension__ ({ \
6230 uint16x4_t __ret_32; \
6231 uint16x4_t __s0_32 = __p0_32; \
6232 uint16x4_t __rev0_32; __rev0_32 = __builtin_shufflevector(__s0_32, __s0_32, 3, 2, 1, 0); \
6233 __ret_32 = __noswap_splat_lane_u16(__rev0_32, __p1_32); \
6234 __ret_32 = __builtin_shufflevector(__ret_32, __ret_32, 3, 2, 1, 0); \
6235 __ret_32; \
6217#define vdup_lane_u32(__p0_31, __p1_31) __extension__ ({ \
6218 uint32x2_t __ret_31; \
6219 uint32x2_t __s0_31 = __p0_31; \
6220 uint32x2_t __rev0_31; __rev0_31 = __builtin_shufflevector(__s0_31, __s0_31, 1, 0); \
6221 __ret_31 = __noswap_splat_lane_u32(__rev0_31, __p1_31); \
6222 __ret_31 = __builtin_shufflevector(__ret_31, __ret_31, 1, 0); \
6223 __ret_31; \
62366224})
62376225#endif
62386226
6227#define vdup_lane_u64(__p0_32, __p1_32) __extension__ ({ \
6228 uint64x1_t __ret_32; \
6229 uint64x1_t __s0_32 = __p0_32; \
6230 __ret_32 = splat_lane_u64(__s0_32, __p1_32); \
6231 __ret_32; \
6232})
62396233#ifdef __LITTLE_ENDIAN__
6240#define vdup_lane_s8(__p0_33, __p1_33) __extension__ ({ \
6241 int8x8_t __ret_33; \
6242 int8x8_t __s0_33 = __p0_33; \
6243 __ret_33 = splat_lane_s8(__s0_33, __p1_33); \
6234#define vdup_lane_u16(__p0_33, __p1_33) __extension__ ({ \
6235 uint16x4_t __ret_33; \
6236 uint16x4_t __s0_33 = __p0_33; \
6237 __ret_33 = splat_lane_u16(__s0_33, __p1_33); \
62446238 __ret_33; \
62456239})
62466240#else
6247#define vdup_lane_s8(__p0_34, __p1_34) __extension__ ({ \
6248 int8x8_t __ret_34; \
6249 int8x8_t __s0_34 = __p0_34; \
6250 int8x8_t __rev0_34; __rev0_34 = __builtin_shufflevector(__s0_34, __s0_34, 7, 6, 5, 4, 3, 2, 1, 0); \
6251 __ret_34 = __noswap_splat_lane_s8(__rev0_34, __p1_34); \
6252 __ret_34 = __builtin_shufflevector(__ret_34, __ret_34, 7, 6, 5, 4, 3, 2, 1, 0); \
6241#define vdup_lane_u16(__p0_34, __p1_34) __extension__ ({ \
6242 uint16x4_t __ret_34; \
6243 uint16x4_t __s0_34 = __p0_34; \
6244 uint16x4_t __rev0_34; __rev0_34 = __builtin_shufflevector(__s0_34, __s0_34, 3, 2, 1, 0); \
6245 __ret_34 = __noswap_splat_lane_u16(__rev0_34, __p1_34); \
6246 __ret_34 = __builtin_shufflevector(__ret_34, __ret_34, 3, 2, 1, 0); \
62536247 __ret_34; \
62546248})
62556249#endif
62566250
62576251#ifdef __LITTLE_ENDIAN__
6258#define vdup_lane_f32(__p0_35, __p1_35) __extension__ ({ \
6259 float32x2_t __ret_35; \
6260 float32x2_t __s0_35 = __p0_35; \
6261 __ret_35 = splat_lane_f32(__s0_35, __p1_35); \
6252#define vdup_lane_s8(__p0_35, __p1_35) __extension__ ({ \
6253 int8x8_t __ret_35; \
6254 int8x8_t __s0_35 = __p0_35; \
6255 __ret_35 = splat_lane_s8(__s0_35, __p1_35); \
62626256 __ret_35; \
62636257})
62646258#else
6265#define vdup_lane_f32(__p0_36, __p1_36) __extension__ ({ \
6266 float32x2_t __ret_36; \
6267 float32x2_t __s0_36 = __p0_36; \
6268 float32x2_t __rev0_36; __rev0_36 = __builtin_shufflevector(__s0_36, __s0_36, 1, 0); \
6269 __ret_36 = __noswap_splat_lane_f32(__rev0_36, __p1_36); \
6270 __ret_36 = __builtin_shufflevector(__ret_36, __ret_36, 1, 0); \
6259#define vdup_lane_s8(__p0_36, __p1_36) __extension__ ({ \
6260 int8x8_t __ret_36; \
6261 int8x8_t __s0_36 = __p0_36; \
6262 int8x8_t __rev0_36; __rev0_36 = __builtin_shufflevector(__s0_36, __s0_36, 7, 6, 5, 4, 3, 2, 1, 0); \
6263 __ret_36 = __noswap_splat_lane_s8(__rev0_36, __p1_36); \
6264 __ret_36 = __builtin_shufflevector(__ret_36, __ret_36, 7, 6, 5, 4, 3, 2, 1, 0); \
62716265 __ret_36; \
62726266})
62736267#endif
62746268
62756269#ifdef __LITTLE_ENDIAN__
6276#define vdup_lane_s32(__p0_37, __p1_37) __extension__ ({ \
6277 int32x2_t __ret_37; \
6278 int32x2_t __s0_37 = __p0_37; \
6279 __ret_37 = splat_lane_s32(__s0_37, __p1_37); \
6270#define vdup_lane_f32(__p0_37, __p1_37) __extension__ ({ \
6271 float32x2_t __ret_37; \
6272 float32x2_t __s0_37 = __p0_37; \
6273 __ret_37 = splat_lane_f32(__s0_37, __p1_37); \
62806274 __ret_37; \
62816275})
62826276#else
6283#define vdup_lane_s32(__p0_38, __p1_38) __extension__ ({ \
6284 int32x2_t __ret_38; \
6285 int32x2_t __s0_38 = __p0_38; \
6286 int32x2_t __rev0_38; __rev0_38 = __builtin_shufflevector(__s0_38, __s0_38, 1, 0); \
6287 __ret_38 = __noswap_splat_lane_s32(__rev0_38, __p1_38); \
6277#define vdup_lane_f32(__p0_38, __p1_38) __extension__ ({ \
6278 float32x2_t __ret_38; \
6279 float32x2_t __s0_38 = __p0_38; \
6280 float32x2_t __rev0_38; __rev0_38 = __builtin_shufflevector(__s0_38, __s0_38, 1, 0); \
6281 __ret_38 = __noswap_splat_lane_f32(__rev0_38, __p1_38); \
62886282 __ret_38 = __builtin_shufflevector(__ret_38, __ret_38, 1, 0); \
62896283 __ret_38; \
62906284})
62916285#endif
62926286
6293#define vdup_lane_s64(__p0_39, __p1_39) __extension__ ({ \
6294 int64x1_t __ret_39; \
6295 int64x1_t __s0_39 = __p0_39; \
6296 __ret_39 = splat_lane_s64(__s0_39, __p1_39); \
6287#ifdef __LITTLE_ENDIAN__
6288#define vdup_lane_f16(__p0_39, __p1_39) __extension__ ({ \
6289 float16x4_t __ret_39; \
6290 float16x4_t __s0_39 = __p0_39; \
6291 __ret_39 = splat_lane_f16(__s0_39, __p1_39); \
62976292 __ret_39; \
62986293})
6299#ifdef __LITTLE_ENDIAN__
6300#define vdup_lane_s16(__p0_40, __p1_40) __extension__ ({ \
6301 int16x4_t __ret_40; \
6302 int16x4_t __s0_40 = __p0_40; \
6303 __ret_40 = splat_lane_s16(__s0_40, __p1_40); \
6294#else
6295#define vdup_lane_f16(__p0_40, __p1_40) __extension__ ({ \
6296 float16x4_t __ret_40; \
6297 float16x4_t __s0_40 = __p0_40; \
6298 float16x4_t __rev0_40; __rev0_40 = __builtin_shufflevector(__s0_40, __s0_40, 3, 2, 1, 0); \
6299 __ret_40 = __noswap_splat_lane_f16(__rev0_40, __p1_40); \
6300 __ret_40 = __builtin_shufflevector(__ret_40, __ret_40, 3, 2, 1, 0); \
63046301 __ret_40; \
63056302})
6306#else
6307#define vdup_lane_s16(__p0_41, __p1_41) __extension__ ({ \
6308 int16x4_t __ret_41; \
6309 int16x4_t __s0_41 = __p0_41; \
6310 int16x4_t __rev0_41; __rev0_41 = __builtin_shufflevector(__s0_41, __s0_41, 3, 2, 1, 0); \
6311 __ret_41 = __noswap_splat_lane_s16(__rev0_41, __p1_41); \
6312 __ret_41 = __builtin_shufflevector(__ret_41, __ret_41, 3, 2, 1, 0); \
6303#endif
6304
6305#ifdef __LITTLE_ENDIAN__
6306#define vdup_lane_s32(__p0_41, __p1_41) __extension__ ({ \
6307 int32x2_t __ret_41; \
6308 int32x2_t __s0_41 = __p0_41; \
6309 __ret_41 = splat_lane_s32(__s0_41, __p1_41); \
63136310 __ret_41; \
63146311})
6312#else
6313#define vdup_lane_s32(__p0_42, __p1_42) __extension__ ({ \
6314 int32x2_t __ret_42; \
6315 int32x2_t __s0_42 = __p0_42; \
6316 int32x2_t __rev0_42; __rev0_42 = __builtin_shufflevector(__s0_42, __s0_42, 1, 0); \
6317 __ret_42 = __noswap_splat_lane_s32(__rev0_42, __p1_42); \
6318 __ret_42 = __builtin_shufflevector(__ret_42, __ret_42, 1, 0); \
6319 __ret_42; \
6320})
6321#endif
6322
6323#define vdup_lane_s64(__p0_43, __p1_43) __extension__ ({ \
6324 int64x1_t __ret_43; \
6325 int64x1_t __s0_43 = __p0_43; \
6326 __ret_43 = splat_lane_s64(__s0_43, __p1_43); \
6327 __ret_43; \
6328})
6329#ifdef __LITTLE_ENDIAN__
6330#define vdup_lane_s16(__p0_44, __p1_44) __extension__ ({ \
6331 int16x4_t __ret_44; \
6332 int16x4_t __s0_44 = __p0_44; \
6333 __ret_44 = splat_lane_s16(__s0_44, __p1_44); \
6334 __ret_44; \
6335})
6336#else
6337#define vdup_lane_s16(__p0_45, __p1_45) __extension__ ({ \
6338 int16x4_t __ret_45; \
6339 int16x4_t __s0_45 = __p0_45; \
6340 int16x4_t __rev0_45; __rev0_45 = __builtin_shufflevector(__s0_45, __s0_45, 3, 2, 1, 0); \
6341 __ret_45 = __noswap_splat_lane_s16(__rev0_45, __p1_45); \
6342 __ret_45 = __builtin_shufflevector(__ret_45, __ret_45, 3, 2, 1, 0); \
6343 __ret_45; \
6344})
63156345#endif
63166346
63176347#ifdef __LITTLE_ENDIAN__
......@@ -14668,245 +14698,245 @@ __ai int16x4_t vmla_s16(int16x4_t __p0, int16x4_t __p1, int16x4_t __p2) {
1466814698#endif
1466914699
1467014700#ifdef __LITTLE_ENDIAN__
14671#define vmlaq_lane_u32(__p0_42, __p1_42, __p2_42, __p3_42) __extension__ ({ \
14672 uint32x4_t __ret_42; \
14673 uint32x4_t __s0_42 = __p0_42; \
14674 uint32x4_t __s1_42 = __p1_42; \
14675 uint32x2_t __s2_42 = __p2_42; \
14676 __ret_42 = __s0_42 + __s1_42 * splatq_lane_u32(__s2_42, __p3_42); \
14677 __ret_42; \
14678})
14679#else
14680#define vmlaq_lane_u32(__p0_43, __p1_43, __p2_43, __p3_43) __extension__ ({ \
14681 uint32x4_t __ret_43; \
14682 uint32x4_t __s0_43 = __p0_43; \
14683 uint32x4_t __s1_43 = __p1_43; \
14684 uint32x2_t __s2_43 = __p2_43; \
14685 uint32x4_t __rev0_43; __rev0_43 = __builtin_shufflevector(__s0_43, __s0_43, 3, 2, 1, 0); \
14686 uint32x4_t __rev1_43; __rev1_43 = __builtin_shufflevector(__s1_43, __s1_43, 3, 2, 1, 0); \
14687 uint32x2_t __rev2_43; __rev2_43 = __builtin_shufflevector(__s2_43, __s2_43, 1, 0); \
14688 __ret_43 = __rev0_43 + __rev1_43 * __noswap_splatq_lane_u32(__rev2_43, __p3_43); \
14689 __ret_43 = __builtin_shufflevector(__ret_43, __ret_43, 3, 2, 1, 0); \
14690 __ret_43; \
14691})
14692#endif
14693
14694#ifdef __LITTLE_ENDIAN__
14695#define vmlaq_lane_u16(__p0_44, __p1_44, __p2_44, __p3_44) __extension__ ({ \
14696 uint16x8_t __ret_44; \
14697 uint16x8_t __s0_44 = __p0_44; \
14698 uint16x8_t __s1_44 = __p1_44; \
14699 uint16x4_t __s2_44 = __p2_44; \
14700 __ret_44 = __s0_44 + __s1_44 * splatq_lane_u16(__s2_44, __p3_44); \
14701 __ret_44; \
14702})
14703#else
14704#define vmlaq_lane_u16(__p0_45, __p1_45, __p2_45, __p3_45) __extension__ ({ \
14705 uint16x8_t __ret_45; \
14706 uint16x8_t __s0_45 = __p0_45; \
14707 uint16x8_t __s1_45 = __p1_45; \
14708 uint16x4_t __s2_45 = __p2_45; \
14709 uint16x8_t __rev0_45; __rev0_45 = __builtin_shufflevector(__s0_45, __s0_45, 7, 6, 5, 4, 3, 2, 1, 0); \
14710 uint16x8_t __rev1_45; __rev1_45 = __builtin_shufflevector(__s1_45, __s1_45, 7, 6, 5, 4, 3, 2, 1, 0); \
14711 uint16x4_t __rev2_45; __rev2_45 = __builtin_shufflevector(__s2_45, __s2_45, 3, 2, 1, 0); \
14712 __ret_45 = __rev0_45 + __rev1_45 * __noswap_splatq_lane_u16(__rev2_45, __p3_45); \
14713 __ret_45 = __builtin_shufflevector(__ret_45, __ret_45, 7, 6, 5, 4, 3, 2, 1, 0); \
14714 __ret_45; \
14715})
14716#endif
14717
14718#ifdef __LITTLE_ENDIAN__
14719#define vmlaq_lane_f32(__p0_46, __p1_46, __p2_46, __p3_46) __extension__ ({ \
14720 float32x4_t __ret_46; \
14721 float32x4_t __s0_46 = __p0_46; \
14722 float32x4_t __s1_46 = __p1_46; \
14723 float32x2_t __s2_46 = __p2_46; \
14724 __ret_46 = __s0_46 + __s1_46 * splatq_lane_f32(__s2_46, __p3_46); \
14701#define vmlaq_lane_u32(__p0_46, __p1_46, __p2_46, __p3_46) __extension__ ({ \
14702 uint32x4_t __ret_46; \
14703 uint32x4_t __s0_46 = __p0_46; \
14704 uint32x4_t __s1_46 = __p1_46; \
14705 uint32x2_t __s2_46 = __p2_46; \
14706 __ret_46 = __s0_46 + __s1_46 * splatq_lane_u32(__s2_46, __p3_46); \
1472514707 __ret_46; \
1472614708})
1472714709#else
14728#define vmlaq_lane_f32(__p0_47, __p1_47, __p2_47, __p3_47) __extension__ ({ \
14729 float32x4_t __ret_47; \
14730 float32x4_t __s0_47 = __p0_47; \
14731 float32x4_t __s1_47 = __p1_47; \
14732 float32x2_t __s2_47 = __p2_47; \
14733 float32x4_t __rev0_47; __rev0_47 = __builtin_shufflevector(__s0_47, __s0_47, 3, 2, 1, 0); \
14734 float32x4_t __rev1_47; __rev1_47 = __builtin_shufflevector(__s1_47, __s1_47, 3, 2, 1, 0); \
14735 float32x2_t __rev2_47; __rev2_47 = __builtin_shufflevector(__s2_47, __s2_47, 1, 0); \
14736 __ret_47 = __rev0_47 + __rev1_47 * __noswap_splatq_lane_f32(__rev2_47, __p3_47); \
14710#define vmlaq_lane_u32(__p0_47, __p1_47, __p2_47, __p3_47) __extension__ ({ \
14711 uint32x4_t __ret_47; \
14712 uint32x4_t __s0_47 = __p0_47; \
14713 uint32x4_t __s1_47 = __p1_47; \
14714 uint32x2_t __s2_47 = __p2_47; \
14715 uint32x4_t __rev0_47; __rev0_47 = __builtin_shufflevector(__s0_47, __s0_47, 3, 2, 1, 0); \
14716 uint32x4_t __rev1_47; __rev1_47 = __builtin_shufflevector(__s1_47, __s1_47, 3, 2, 1, 0); \
14717 uint32x2_t __rev2_47; __rev2_47 = __builtin_shufflevector(__s2_47, __s2_47, 1, 0); \
14718 __ret_47 = __rev0_47 + __rev1_47 * __noswap_splatq_lane_u32(__rev2_47, __p3_47); \
1473714719 __ret_47 = __builtin_shufflevector(__ret_47, __ret_47, 3, 2, 1, 0); \
1473814720 __ret_47; \
1473914721})
1474014722#endif
1474114723
1474214724#ifdef __LITTLE_ENDIAN__
14743#define vmlaq_lane_s32(__p0_48, __p1_48, __p2_48, __p3_48) __extension__ ({ \
14744 int32x4_t __ret_48; \
14745 int32x4_t __s0_48 = __p0_48; \
14746 int32x4_t __s1_48 = __p1_48; \
14747 int32x2_t __s2_48 = __p2_48; \
14748 __ret_48 = __s0_48 + __s1_48 * splatq_lane_s32(__s2_48, __p3_48); \
14725#define vmlaq_lane_u16(__p0_48, __p1_48, __p2_48, __p3_48) __extension__ ({ \
14726 uint16x8_t __ret_48; \
14727 uint16x8_t __s0_48 = __p0_48; \
14728 uint16x8_t __s1_48 = __p1_48; \
14729 uint16x4_t __s2_48 = __p2_48; \
14730 __ret_48 = __s0_48 + __s1_48 * splatq_lane_u16(__s2_48, __p3_48); \
1474914731 __ret_48; \
1475014732})
1475114733#else
14752#define vmlaq_lane_s32(__p0_49, __p1_49, __p2_49, __p3_49) __extension__ ({ \
14753 int32x4_t __ret_49; \
14754 int32x4_t __s0_49 = __p0_49; \
14755 int32x4_t __s1_49 = __p1_49; \
14756 int32x2_t __s2_49 = __p2_49; \
14757 int32x4_t __rev0_49; __rev0_49 = __builtin_shufflevector(__s0_49, __s0_49, 3, 2, 1, 0); \
14758 int32x4_t __rev1_49; __rev1_49 = __builtin_shufflevector(__s1_49, __s1_49, 3, 2, 1, 0); \
14759 int32x2_t __rev2_49; __rev2_49 = __builtin_shufflevector(__s2_49, __s2_49, 1, 0); \
14760 __ret_49 = __rev0_49 + __rev1_49 * __noswap_splatq_lane_s32(__rev2_49, __p3_49); \
14761 __ret_49 = __builtin_shufflevector(__ret_49, __ret_49, 3, 2, 1, 0); \
14734#define vmlaq_lane_u16(__p0_49, __p1_49, __p2_49, __p3_49) __extension__ ({ \
14735 uint16x8_t __ret_49; \
14736 uint16x8_t __s0_49 = __p0_49; \
14737 uint16x8_t __s1_49 = __p1_49; \
14738 uint16x4_t __s2_49 = __p2_49; \
14739 uint16x8_t __rev0_49; __rev0_49 = __builtin_shufflevector(__s0_49, __s0_49, 7, 6, 5, 4, 3, 2, 1, 0); \
14740 uint16x8_t __rev1_49; __rev1_49 = __builtin_shufflevector(__s1_49, __s1_49, 7, 6, 5, 4, 3, 2, 1, 0); \
14741 uint16x4_t __rev2_49; __rev2_49 = __builtin_shufflevector(__s2_49, __s2_49, 3, 2, 1, 0); \
14742 __ret_49 = __rev0_49 + __rev1_49 * __noswap_splatq_lane_u16(__rev2_49, __p3_49); \
14743 __ret_49 = __builtin_shufflevector(__ret_49, __ret_49, 7, 6, 5, 4, 3, 2, 1, 0); \
1476214744 __ret_49; \
1476314745})
1476414746#endif
1476514747
1476614748#ifdef __LITTLE_ENDIAN__
14767#define vmlaq_lane_s16(__p0_50, __p1_50, __p2_50, __p3_50) __extension__ ({ \
14768 int16x8_t __ret_50; \
14769 int16x8_t __s0_50 = __p0_50; \
14770 int16x8_t __s1_50 = __p1_50; \
14771 int16x4_t __s2_50 = __p2_50; \
14772 __ret_50 = __s0_50 + __s1_50 * splatq_lane_s16(__s2_50, __p3_50); \
14749#define vmlaq_lane_f32(__p0_50, __p1_50, __p2_50, __p3_50) __extension__ ({ \
14750 float32x4_t __ret_50; \
14751 float32x4_t __s0_50 = __p0_50; \
14752 float32x4_t __s1_50 = __p1_50; \
14753 float32x2_t __s2_50 = __p2_50; \
14754 __ret_50 = __s0_50 + __s1_50 * splatq_lane_f32(__s2_50, __p3_50); \
1477314755 __ret_50; \
1477414756})
1477514757#else
14776#define vmlaq_lane_s16(__p0_51, __p1_51, __p2_51, __p3_51) __extension__ ({ \
14777 int16x8_t __ret_51; \
14778 int16x8_t __s0_51 = __p0_51; \
14779 int16x8_t __s1_51 = __p1_51; \
14780 int16x4_t __s2_51 = __p2_51; \
14781 int16x8_t __rev0_51; __rev0_51 = __builtin_shufflevector(__s0_51, __s0_51, 7, 6, 5, 4, 3, 2, 1, 0); \
14782 int16x8_t __rev1_51; __rev1_51 = __builtin_shufflevector(__s1_51, __s1_51, 7, 6, 5, 4, 3, 2, 1, 0); \
14783 int16x4_t __rev2_51; __rev2_51 = __builtin_shufflevector(__s2_51, __s2_51, 3, 2, 1, 0); \
14784 __ret_51 = __rev0_51 + __rev1_51 * __noswap_splatq_lane_s16(__rev2_51, __p3_51); \
14785 __ret_51 = __builtin_shufflevector(__ret_51, __ret_51, 7, 6, 5, 4, 3, 2, 1, 0); \
14758#define vmlaq_lane_f32(__p0_51, __p1_51, __p2_51, __p3_51) __extension__ ({ \
14759 float32x4_t __ret_51; \
14760 float32x4_t __s0_51 = __p0_51; \
14761 float32x4_t __s1_51 = __p1_51; \
14762 float32x2_t __s2_51 = __p2_51; \
14763 float32x4_t __rev0_51; __rev0_51 = __builtin_shufflevector(__s0_51, __s0_51, 3, 2, 1, 0); \
14764 float32x4_t __rev1_51; __rev1_51 = __builtin_shufflevector(__s1_51, __s1_51, 3, 2, 1, 0); \
14765 float32x2_t __rev2_51; __rev2_51 = __builtin_shufflevector(__s2_51, __s2_51, 1, 0); \
14766 __ret_51 = __rev0_51 + __rev1_51 * __noswap_splatq_lane_f32(__rev2_51, __p3_51); \
14767 __ret_51 = __builtin_shufflevector(__ret_51, __ret_51, 3, 2, 1, 0); \
1478614768 __ret_51; \
1478714769})
1478814770#endif
1478914771
1479014772#ifdef __LITTLE_ENDIAN__
14791#define vmla_lane_u32(__p0_52, __p1_52, __p2_52, __p3_52) __extension__ ({ \
14792 uint32x2_t __ret_52; \
14793 uint32x2_t __s0_52 = __p0_52; \
14794 uint32x2_t __s1_52 = __p1_52; \
14795 uint32x2_t __s2_52 = __p2_52; \
14796 __ret_52 = __s0_52 + __s1_52 * splat_lane_u32(__s2_52, __p3_52); \
14773#define vmlaq_lane_s32(__p0_52, __p1_52, __p2_52, __p3_52) __extension__ ({ \
14774 int32x4_t __ret_52; \
14775 int32x4_t __s0_52 = __p0_52; \
14776 int32x4_t __s1_52 = __p1_52; \
14777 int32x2_t __s2_52 = __p2_52; \
14778 __ret_52 = __s0_52 + __s1_52 * splatq_lane_s32(__s2_52, __p3_52); \
1479714779 __ret_52; \
1479814780})
1479914781#else
14800#define vmla_lane_u32(__p0_53, __p1_53, __p2_53, __p3_53) __extension__ ({ \
14801 uint32x2_t __ret_53; \
14802 uint32x2_t __s0_53 = __p0_53; \
14803 uint32x2_t __s1_53 = __p1_53; \
14804 uint32x2_t __s2_53 = __p2_53; \
14805 uint32x2_t __rev0_53; __rev0_53 = __builtin_shufflevector(__s0_53, __s0_53, 1, 0); \
14806 uint32x2_t __rev1_53; __rev1_53 = __builtin_shufflevector(__s1_53, __s1_53, 1, 0); \
14807 uint32x2_t __rev2_53; __rev2_53 = __builtin_shufflevector(__s2_53, __s2_53, 1, 0); \
14808 __ret_53 = __rev0_53 + __rev1_53 * __noswap_splat_lane_u32(__rev2_53, __p3_53); \
14809 __ret_53 = __builtin_shufflevector(__ret_53, __ret_53, 1, 0); \
14782#define vmlaq_lane_s32(__p0_53, __p1_53, __p2_53, __p3_53) __extension__ ({ \
14783 int32x4_t __ret_53; \
14784 int32x4_t __s0_53 = __p0_53; \
14785 int32x4_t __s1_53 = __p1_53; \
14786 int32x2_t __s2_53 = __p2_53; \
14787 int32x4_t __rev0_53; __rev0_53 = __builtin_shufflevector(__s0_53, __s0_53, 3, 2, 1, 0); \
14788 int32x4_t __rev1_53; __rev1_53 = __builtin_shufflevector(__s1_53, __s1_53, 3, 2, 1, 0); \
14789 int32x2_t __rev2_53; __rev2_53 = __builtin_shufflevector(__s2_53, __s2_53, 1, 0); \
14790 __ret_53 = __rev0_53 + __rev1_53 * __noswap_splatq_lane_s32(__rev2_53, __p3_53); \
14791 __ret_53 = __builtin_shufflevector(__ret_53, __ret_53, 3, 2, 1, 0); \
1481014792 __ret_53; \
1481114793})
1481214794#endif
1481314795
1481414796#ifdef __LITTLE_ENDIAN__
14815#define vmla_lane_u16(__p0_54, __p1_54, __p2_54, __p3_54) __extension__ ({ \
14816 uint16x4_t __ret_54; \
14817 uint16x4_t __s0_54 = __p0_54; \
14818 uint16x4_t __s1_54 = __p1_54; \
14819 uint16x4_t __s2_54 = __p2_54; \
14820 __ret_54 = __s0_54 + __s1_54 * splat_lane_u16(__s2_54, __p3_54); \
14797#define vmlaq_lane_s16(__p0_54, __p1_54, __p2_54, __p3_54) __extension__ ({ \
14798 int16x8_t __ret_54; \
14799 int16x8_t __s0_54 = __p0_54; \
14800 int16x8_t __s1_54 = __p1_54; \
14801 int16x4_t __s2_54 = __p2_54; \
14802 __ret_54 = __s0_54 + __s1_54 * splatq_lane_s16(__s2_54, __p3_54); \
1482114803 __ret_54; \
1482214804})
1482314805#else
14824#define vmla_lane_u16(__p0_55, __p1_55, __p2_55, __p3_55) __extension__ ({ \
14825 uint16x4_t __ret_55; \
14826 uint16x4_t __s0_55 = __p0_55; \
14827 uint16x4_t __s1_55 = __p1_55; \
14828 uint16x4_t __s2_55 = __p2_55; \
14829 uint16x4_t __rev0_55; __rev0_55 = __builtin_shufflevector(__s0_55, __s0_55, 3, 2, 1, 0); \
14830 uint16x4_t __rev1_55; __rev1_55 = __builtin_shufflevector(__s1_55, __s1_55, 3, 2, 1, 0); \
14831 uint16x4_t __rev2_55; __rev2_55 = __builtin_shufflevector(__s2_55, __s2_55, 3, 2, 1, 0); \
14832 __ret_55 = __rev0_55 + __rev1_55 * __noswap_splat_lane_u16(__rev2_55, __p3_55); \
14833 __ret_55 = __builtin_shufflevector(__ret_55, __ret_55, 3, 2, 1, 0); \
14806#define vmlaq_lane_s16(__p0_55, __p1_55, __p2_55, __p3_55) __extension__ ({ \
14807 int16x8_t __ret_55; \
14808 int16x8_t __s0_55 = __p0_55; \
14809 int16x8_t __s1_55 = __p1_55; \
14810 int16x4_t __s2_55 = __p2_55; \
14811 int16x8_t __rev0_55; __rev0_55 = __builtin_shufflevector(__s0_55, __s0_55, 7, 6, 5, 4, 3, 2, 1, 0); \
14812 int16x8_t __rev1_55; __rev1_55 = __builtin_shufflevector(__s1_55, __s1_55, 7, 6, 5, 4, 3, 2, 1, 0); \
14813 int16x4_t __rev2_55; __rev2_55 = __builtin_shufflevector(__s2_55, __s2_55, 3, 2, 1, 0); \
14814 __ret_55 = __rev0_55 + __rev1_55 * __noswap_splatq_lane_s16(__rev2_55, __p3_55); \
14815 __ret_55 = __builtin_shufflevector(__ret_55, __ret_55, 7, 6, 5, 4, 3, 2, 1, 0); \
1483414816 __ret_55; \
1483514817})
1483614818#endif
1483714819
1483814820#ifdef __LITTLE_ENDIAN__
14839#define vmla_lane_f32(__p0_56, __p1_56, __p2_56, __p3_56) __extension__ ({ \
14840 float32x2_t __ret_56; \
14841 float32x2_t __s0_56 = __p0_56; \
14842 float32x2_t __s1_56 = __p1_56; \
14843 float32x2_t __s2_56 = __p2_56; \
14844 __ret_56 = __s0_56 + __s1_56 * splat_lane_f32(__s2_56, __p3_56); \
14821#define vmla_lane_u32(__p0_56, __p1_56, __p2_56, __p3_56) __extension__ ({ \
14822 uint32x2_t __ret_56; \
14823 uint32x2_t __s0_56 = __p0_56; \
14824 uint32x2_t __s1_56 = __p1_56; \
14825 uint32x2_t __s2_56 = __p2_56; \
14826 __ret_56 = __s0_56 + __s1_56 * splat_lane_u32(__s2_56, __p3_56); \
1484514827 __ret_56; \
1484614828})
1484714829#else
14848#define vmla_lane_f32(__p0_57, __p1_57, __p2_57, __p3_57) __extension__ ({ \
14849 float32x2_t __ret_57; \
14850 float32x2_t __s0_57 = __p0_57; \
14851 float32x2_t __s1_57 = __p1_57; \
14852 float32x2_t __s2_57 = __p2_57; \
14853 float32x2_t __rev0_57; __rev0_57 = __builtin_shufflevector(__s0_57, __s0_57, 1, 0); \
14854 float32x2_t __rev1_57; __rev1_57 = __builtin_shufflevector(__s1_57, __s1_57, 1, 0); \
14855 float32x2_t __rev2_57; __rev2_57 = __builtin_shufflevector(__s2_57, __s2_57, 1, 0); \
14856 __ret_57 = __rev0_57 + __rev1_57 * __noswap_splat_lane_f32(__rev2_57, __p3_57); \
14830#define vmla_lane_u32(__p0_57, __p1_57, __p2_57, __p3_57) __extension__ ({ \
14831 uint32x2_t __ret_57; \
14832 uint32x2_t __s0_57 = __p0_57; \
14833 uint32x2_t __s1_57 = __p1_57; \
14834 uint32x2_t __s2_57 = __p2_57; \
14835 uint32x2_t __rev0_57; __rev0_57 = __builtin_shufflevector(__s0_57, __s0_57, 1, 0); \
14836 uint32x2_t __rev1_57; __rev1_57 = __builtin_shufflevector(__s1_57, __s1_57, 1, 0); \
14837 uint32x2_t __rev2_57; __rev2_57 = __builtin_shufflevector(__s2_57, __s2_57, 1, 0); \
14838 __ret_57 = __rev0_57 + __rev1_57 * __noswap_splat_lane_u32(__rev2_57, __p3_57); \
1485714839 __ret_57 = __builtin_shufflevector(__ret_57, __ret_57, 1, 0); \
1485814840 __ret_57; \
1485914841})
1486014842#endif
1486114843
1486214844#ifdef __LITTLE_ENDIAN__
14863#define vmla_lane_s32(__p0_58, __p1_58, __p2_58, __p3_58) __extension__ ({ \
14864 int32x2_t __ret_58; \
14865 int32x2_t __s0_58 = __p0_58; \
14866 int32x2_t __s1_58 = __p1_58; \
14867 int32x2_t __s2_58 = __p2_58; \
14868 __ret_58 = __s0_58 + __s1_58 * splat_lane_s32(__s2_58, __p3_58); \
14845#define vmla_lane_u16(__p0_58, __p1_58, __p2_58, __p3_58) __extension__ ({ \
14846 uint16x4_t __ret_58; \
14847 uint16x4_t __s0_58 = __p0_58; \
14848 uint16x4_t __s1_58 = __p1_58; \
14849 uint16x4_t __s2_58 = __p2_58; \
14850 __ret_58 = __s0_58 + __s1_58 * splat_lane_u16(__s2_58, __p3_58); \
1486914851 __ret_58; \
1487014852})
1487114853#else
14872#define vmla_lane_s32(__p0_59, __p1_59, __p2_59, __p3_59) __extension__ ({ \
14873 int32x2_t __ret_59; \
14874 int32x2_t __s0_59 = __p0_59; \
14875 int32x2_t __s1_59 = __p1_59; \
14876 int32x2_t __s2_59 = __p2_59; \
14877 int32x2_t __rev0_59; __rev0_59 = __builtin_shufflevector(__s0_59, __s0_59, 1, 0); \
14878 int32x2_t __rev1_59; __rev1_59 = __builtin_shufflevector(__s1_59, __s1_59, 1, 0); \
14879 int32x2_t __rev2_59; __rev2_59 = __builtin_shufflevector(__s2_59, __s2_59, 1, 0); \
14880 __ret_59 = __rev0_59 + __rev1_59 * __noswap_splat_lane_s32(__rev2_59, __p3_59); \
14881 __ret_59 = __builtin_shufflevector(__ret_59, __ret_59, 1, 0); \
14854#define vmla_lane_u16(__p0_59, __p1_59, __p2_59, __p3_59) __extension__ ({ \
14855 uint16x4_t __ret_59; \
14856 uint16x4_t __s0_59 = __p0_59; \
14857 uint16x4_t __s1_59 = __p1_59; \
14858 uint16x4_t __s2_59 = __p2_59; \
14859 uint16x4_t __rev0_59; __rev0_59 = __builtin_shufflevector(__s0_59, __s0_59, 3, 2, 1, 0); \
14860 uint16x4_t __rev1_59; __rev1_59 = __builtin_shufflevector(__s1_59, __s1_59, 3, 2, 1, 0); \
14861 uint16x4_t __rev2_59; __rev2_59 = __builtin_shufflevector(__s2_59, __s2_59, 3, 2, 1, 0); \
14862 __ret_59 = __rev0_59 + __rev1_59 * __noswap_splat_lane_u16(__rev2_59, __p3_59); \
14863 __ret_59 = __builtin_shufflevector(__ret_59, __ret_59, 3, 2, 1, 0); \
1488214864 __ret_59; \
1488314865})
1488414866#endif
1488514867
1488614868#ifdef __LITTLE_ENDIAN__
14887#define vmla_lane_s16(__p0_60, __p1_60, __p2_60, __p3_60) __extension__ ({ \
14888 int16x4_t __ret_60; \
14889 int16x4_t __s0_60 = __p0_60; \
14890 int16x4_t __s1_60 = __p1_60; \
14891 int16x4_t __s2_60 = __p2_60; \
14892 __ret_60 = __s0_60 + __s1_60 * splat_lane_s16(__s2_60, __p3_60); \
14869#define vmla_lane_f32(__p0_60, __p1_60, __p2_60, __p3_60) __extension__ ({ \
14870 float32x2_t __ret_60; \
14871 float32x2_t __s0_60 = __p0_60; \
14872 float32x2_t __s1_60 = __p1_60; \
14873 float32x2_t __s2_60 = __p2_60; \
14874 __ret_60 = __s0_60 + __s1_60 * splat_lane_f32(__s2_60, __p3_60); \
1489314875 __ret_60; \
1489414876})
1489514877#else
14896#define vmla_lane_s16(__p0_61, __p1_61, __p2_61, __p3_61) __extension__ ({ \
14897 int16x4_t __ret_61; \
14898 int16x4_t __s0_61 = __p0_61; \
14899 int16x4_t __s1_61 = __p1_61; \
14900 int16x4_t __s2_61 = __p2_61; \
14901 int16x4_t __rev0_61; __rev0_61 = __builtin_shufflevector(__s0_61, __s0_61, 3, 2, 1, 0); \
14902 int16x4_t __rev1_61; __rev1_61 = __builtin_shufflevector(__s1_61, __s1_61, 3, 2, 1, 0); \
14903 int16x4_t __rev2_61; __rev2_61 = __builtin_shufflevector(__s2_61, __s2_61, 3, 2, 1, 0); \
14904 __ret_61 = __rev0_61 + __rev1_61 * __noswap_splat_lane_s16(__rev2_61, __p3_61); \
14905 __ret_61 = __builtin_shufflevector(__ret_61, __ret_61, 3, 2, 1, 0); \
14878#define vmla_lane_f32(__p0_61, __p1_61, __p2_61, __p3_61) __extension__ ({ \
14879 float32x2_t __ret_61; \
14880 float32x2_t __s0_61 = __p0_61; \
14881 float32x2_t __s1_61 = __p1_61; \
14882 float32x2_t __s2_61 = __p2_61; \
14883 float32x2_t __rev0_61; __rev0_61 = __builtin_shufflevector(__s0_61, __s0_61, 1, 0); \
14884 float32x2_t __rev1_61; __rev1_61 = __builtin_shufflevector(__s1_61, __s1_61, 1, 0); \
14885 float32x2_t __rev2_61; __rev2_61 = __builtin_shufflevector(__s2_61, __s2_61, 1, 0); \
14886 __ret_61 = __rev0_61 + __rev1_61 * __noswap_splat_lane_f32(__rev2_61, __p3_61); \
14887 __ret_61 = __builtin_shufflevector(__ret_61, __ret_61, 1, 0); \
1490614888 __ret_61; \
1490714889})
1490814890#endif
1490914891
14892#ifdef __LITTLE_ENDIAN__
14893#define vmla_lane_s32(__p0_62, __p1_62, __p2_62, __p3_62) __extension__ ({ \
14894 int32x2_t __ret_62; \
14895 int32x2_t __s0_62 = __p0_62; \
14896 int32x2_t __s1_62 = __p1_62; \
14897 int32x2_t __s2_62 = __p2_62; \
14898 __ret_62 = __s0_62 + __s1_62 * splat_lane_s32(__s2_62, __p3_62); \
14899 __ret_62; \
14900})
14901#else
14902#define vmla_lane_s32(__p0_63, __p1_63, __p2_63, __p3_63) __extension__ ({ \
14903 int32x2_t __ret_63; \
14904 int32x2_t __s0_63 = __p0_63; \
14905 int32x2_t __s1_63 = __p1_63; \
14906 int32x2_t __s2_63 = __p2_63; \
14907 int32x2_t __rev0_63; __rev0_63 = __builtin_shufflevector(__s0_63, __s0_63, 1, 0); \
14908 int32x2_t __rev1_63; __rev1_63 = __builtin_shufflevector(__s1_63, __s1_63, 1, 0); \
14909 int32x2_t __rev2_63; __rev2_63 = __builtin_shufflevector(__s2_63, __s2_63, 1, 0); \
14910 __ret_63 = __rev0_63 + __rev1_63 * __noswap_splat_lane_s32(__rev2_63, __p3_63); \
14911 __ret_63 = __builtin_shufflevector(__ret_63, __ret_63, 1, 0); \
14912 __ret_63; \
14913})
14914#endif
14915
14916#ifdef __LITTLE_ENDIAN__
14917#define vmla_lane_s16(__p0_64, __p1_64, __p2_64, __p3_64) __extension__ ({ \
14918 int16x4_t __ret_64; \
14919 int16x4_t __s0_64 = __p0_64; \
14920 int16x4_t __s1_64 = __p1_64; \
14921 int16x4_t __s2_64 = __p2_64; \
14922 __ret_64 = __s0_64 + __s1_64 * splat_lane_s16(__s2_64, __p3_64); \
14923 __ret_64; \
14924})
14925#else
14926#define vmla_lane_s16(__p0_65, __p1_65, __p2_65, __p3_65) __extension__ ({ \
14927 int16x4_t __ret_65; \
14928 int16x4_t __s0_65 = __p0_65; \
14929 int16x4_t __s1_65 = __p1_65; \
14930 int16x4_t __s2_65 = __p2_65; \
14931 int16x4_t __rev0_65; __rev0_65 = __builtin_shufflevector(__s0_65, __s0_65, 3, 2, 1, 0); \
14932 int16x4_t __rev1_65; __rev1_65 = __builtin_shufflevector(__s1_65, __s1_65, 3, 2, 1, 0); \
14933 int16x4_t __rev2_65; __rev2_65 = __builtin_shufflevector(__s2_65, __s2_65, 3, 2, 1, 0); \
14934 __ret_65 = __rev0_65 + __rev1_65 * __noswap_splat_lane_s16(__rev2_65, __p3_65); \
14935 __ret_65 = __builtin_shufflevector(__ret_65, __ret_65, 3, 2, 1, 0); \
14936 __ret_65; \
14937})
14938#endif
14939
1491014940#ifdef __LITTLE_ENDIAN__
1491114941__ai uint32x4_t vmlaq_n_u32(uint32x4_t __p0, uint32x4_t __p1, uint32_t __p2) {
1491214942 uint32x4_t __ret;
......@@ -15330,245 +15360,245 @@ __ai int16x4_t vmls_s16(int16x4_t __p0, int16x4_t __p1, int16x4_t __p2) {
1533015360#endif
1533115361
1533215362#ifdef __LITTLE_ENDIAN__
15333#define vmlsq_lane_u32(__p0_62, __p1_62, __p2_62, __p3_62) __extension__ ({ \
15334 uint32x4_t __ret_62; \
15335 uint32x4_t __s0_62 = __p0_62; \
15336 uint32x4_t __s1_62 = __p1_62; \
15337 uint32x2_t __s2_62 = __p2_62; \
15338 __ret_62 = __s0_62 - __s1_62 * splatq_lane_u32(__s2_62, __p3_62); \
15339 __ret_62; \
15340})
15341#else
15342#define vmlsq_lane_u32(__p0_63, __p1_63, __p2_63, __p3_63) __extension__ ({ \
15343 uint32x4_t __ret_63; \
15344 uint32x4_t __s0_63 = __p0_63; \
15345 uint32x4_t __s1_63 = __p1_63; \
15346 uint32x2_t __s2_63 = __p2_63; \
15347 uint32x4_t __rev0_63; __rev0_63 = __builtin_shufflevector(__s0_63, __s0_63, 3, 2, 1, 0); \
15348 uint32x4_t __rev1_63; __rev1_63 = __builtin_shufflevector(__s1_63, __s1_63, 3, 2, 1, 0); \
15349 uint32x2_t __rev2_63; __rev2_63 = __builtin_shufflevector(__s2_63, __s2_63, 1, 0); \
15350 __ret_63 = __rev0_63 - __rev1_63 * __noswap_splatq_lane_u32(__rev2_63, __p3_63); \
15351 __ret_63 = __builtin_shufflevector(__ret_63, __ret_63, 3, 2, 1, 0); \
15352 __ret_63; \
15353})
15354#endif
15355
15356#ifdef __LITTLE_ENDIAN__
15357#define vmlsq_lane_u16(__p0_64, __p1_64, __p2_64, __p3_64) __extension__ ({ \
15358 uint16x8_t __ret_64; \
15359 uint16x8_t __s0_64 = __p0_64; \
15360 uint16x8_t __s1_64 = __p1_64; \
15361 uint16x4_t __s2_64 = __p2_64; \
15362 __ret_64 = __s0_64 - __s1_64 * splatq_lane_u16(__s2_64, __p3_64); \
15363 __ret_64; \
15364})
15365#else
15366#define vmlsq_lane_u16(__p0_65, __p1_65, __p2_65, __p3_65) __extension__ ({ \
15367 uint16x8_t __ret_65; \
15368 uint16x8_t __s0_65 = __p0_65; \
15369 uint16x8_t __s1_65 = __p1_65; \
15370 uint16x4_t __s2_65 = __p2_65; \
15371 uint16x8_t __rev0_65; __rev0_65 = __builtin_shufflevector(__s0_65, __s0_65, 7, 6, 5, 4, 3, 2, 1, 0); \
15372 uint16x8_t __rev1_65; __rev1_65 = __builtin_shufflevector(__s1_65, __s1_65, 7, 6, 5, 4, 3, 2, 1, 0); \
15373 uint16x4_t __rev2_65; __rev2_65 = __builtin_shufflevector(__s2_65, __s2_65, 3, 2, 1, 0); \
15374 __ret_65 = __rev0_65 - __rev1_65 * __noswap_splatq_lane_u16(__rev2_65, __p3_65); \
15375 __ret_65 = __builtin_shufflevector(__ret_65, __ret_65, 7, 6, 5, 4, 3, 2, 1, 0); \
15376 __ret_65; \
15377})
15378#endif
15379
15380#ifdef __LITTLE_ENDIAN__
15381#define vmlsq_lane_f32(__p0_66, __p1_66, __p2_66, __p3_66) __extension__ ({ \
15382 float32x4_t __ret_66; \
15383 float32x4_t __s0_66 = __p0_66; \
15384 float32x4_t __s1_66 = __p1_66; \
15385 float32x2_t __s2_66 = __p2_66; \
15386 __ret_66 = __s0_66 - __s1_66 * splatq_lane_f32(__s2_66, __p3_66); \
15363#define vmlsq_lane_u32(__p0_66, __p1_66, __p2_66, __p3_66) __extension__ ({ \
15364 uint32x4_t __ret_66; \
15365 uint32x4_t __s0_66 = __p0_66; \
15366 uint32x4_t __s1_66 = __p1_66; \
15367 uint32x2_t __s2_66 = __p2_66; \
15368 __ret_66 = __s0_66 - __s1_66 * splatq_lane_u32(__s2_66, __p3_66); \
1538715369 __ret_66; \
1538815370})
1538915371#else
15390#define vmlsq_lane_f32(__p0_67, __p1_67, __p2_67, __p3_67) __extension__ ({ \
15391 float32x4_t __ret_67; \
15392 float32x4_t __s0_67 = __p0_67; \
15393 float32x4_t __s1_67 = __p1_67; \
15394 float32x2_t __s2_67 = __p2_67; \
15395 float32x4_t __rev0_67; __rev0_67 = __builtin_shufflevector(__s0_67, __s0_67, 3, 2, 1, 0); \
15396 float32x4_t __rev1_67; __rev1_67 = __builtin_shufflevector(__s1_67, __s1_67, 3, 2, 1, 0); \
15397 float32x2_t __rev2_67; __rev2_67 = __builtin_shufflevector(__s2_67, __s2_67, 1, 0); \
15398 __ret_67 = __rev0_67 - __rev1_67 * __noswap_splatq_lane_f32(__rev2_67, __p3_67); \
15372#define vmlsq_lane_u32(__p0_67, __p1_67, __p2_67, __p3_67) __extension__ ({ \
15373 uint32x4_t __ret_67; \
15374 uint32x4_t __s0_67 = __p0_67; \
15375 uint32x4_t __s1_67 = __p1_67; \
15376 uint32x2_t __s2_67 = __p2_67; \
15377 uint32x4_t __rev0_67; __rev0_67 = __builtin_shufflevector(__s0_67, __s0_67, 3, 2, 1, 0); \
15378 uint32x4_t __rev1_67; __rev1_67 = __builtin_shufflevector(__s1_67, __s1_67, 3, 2, 1, 0); \
15379 uint32x2_t __rev2_67; __rev2_67 = __builtin_shufflevector(__s2_67, __s2_67, 1, 0); \
15380 __ret_67 = __rev0_67 - __rev1_67 * __noswap_splatq_lane_u32(__rev2_67, __p3_67); \
1539915381 __ret_67 = __builtin_shufflevector(__ret_67, __ret_67, 3, 2, 1, 0); \
1540015382 __ret_67; \
1540115383})
1540215384#endif
1540315385
1540415386#ifdef __LITTLE_ENDIAN__
15405#define vmlsq_lane_s32(__p0_68, __p1_68, __p2_68, __p3_68) __extension__ ({ \
15406 int32x4_t __ret_68; \
15407 int32x4_t __s0_68 = __p0_68; \
15408 int32x4_t __s1_68 = __p1_68; \
15409 int32x2_t __s2_68 = __p2_68; \
15410 __ret_68 = __s0_68 - __s1_68 * splatq_lane_s32(__s2_68, __p3_68); \
15387#define vmlsq_lane_u16(__p0_68, __p1_68, __p2_68, __p3_68) __extension__ ({ \
15388 uint16x8_t __ret_68; \
15389 uint16x8_t __s0_68 = __p0_68; \
15390 uint16x8_t __s1_68 = __p1_68; \
15391 uint16x4_t __s2_68 = __p2_68; \
15392 __ret_68 = __s0_68 - __s1_68 * splatq_lane_u16(__s2_68, __p3_68); \
1541115393 __ret_68; \
1541215394})
1541315395#else
15414#define vmlsq_lane_s32(__p0_69, __p1_69, __p2_69, __p3_69) __extension__ ({ \
15415 int32x4_t __ret_69; \
15416 int32x4_t __s0_69 = __p0_69; \
15417 int32x4_t __s1_69 = __p1_69; \
15418 int32x2_t __s2_69 = __p2_69; \
15419 int32x4_t __rev0_69; __rev0_69 = __builtin_shufflevector(__s0_69, __s0_69, 3, 2, 1, 0); \
15420 int32x4_t __rev1_69; __rev1_69 = __builtin_shufflevector(__s1_69, __s1_69, 3, 2, 1, 0); \
15421 int32x2_t __rev2_69; __rev2_69 = __builtin_shufflevector(__s2_69, __s2_69, 1, 0); \
15422 __ret_69 = __rev0_69 - __rev1_69 * __noswap_splatq_lane_s32(__rev2_69, __p3_69); \
15423 __ret_69 = __builtin_shufflevector(__ret_69, __ret_69, 3, 2, 1, 0); \
15396#define vmlsq_lane_u16(__p0_69, __p1_69, __p2_69, __p3_69) __extension__ ({ \
15397 uint16x8_t __ret_69; \
15398 uint16x8_t __s0_69 = __p0_69; \
15399 uint16x8_t __s1_69 = __p1_69; \
15400 uint16x4_t __s2_69 = __p2_69; \
15401 uint16x8_t __rev0_69; __rev0_69 = __builtin_shufflevector(__s0_69, __s0_69, 7, 6, 5, 4, 3, 2, 1, 0); \
15402 uint16x8_t __rev1_69; __rev1_69 = __builtin_shufflevector(__s1_69, __s1_69, 7, 6, 5, 4, 3, 2, 1, 0); \
15403 uint16x4_t __rev2_69; __rev2_69 = __builtin_shufflevector(__s2_69, __s2_69, 3, 2, 1, 0); \
15404 __ret_69 = __rev0_69 - __rev1_69 * __noswap_splatq_lane_u16(__rev2_69, __p3_69); \
15405 __ret_69 = __builtin_shufflevector(__ret_69, __ret_69, 7, 6, 5, 4, 3, 2, 1, 0); \
1542415406 __ret_69; \
1542515407})
1542615408#endif
1542715409
1542815410#ifdef __LITTLE_ENDIAN__
15429#define vmlsq_lane_s16(__p0_70, __p1_70, __p2_70, __p3_70) __extension__ ({ \
15430 int16x8_t __ret_70; \
15431 int16x8_t __s0_70 = __p0_70; \
15432 int16x8_t __s1_70 = __p1_70; \
15433 int16x4_t __s2_70 = __p2_70; \
15434 __ret_70 = __s0_70 - __s1_70 * splatq_lane_s16(__s2_70, __p3_70); \
15411#define vmlsq_lane_f32(__p0_70, __p1_70, __p2_70, __p3_70) __extension__ ({ \
15412 float32x4_t __ret_70; \
15413 float32x4_t __s0_70 = __p0_70; \
15414 float32x4_t __s1_70 = __p1_70; \
15415 float32x2_t __s2_70 = __p2_70; \
15416 __ret_70 = __s0_70 - __s1_70 * splatq_lane_f32(__s2_70, __p3_70); \
1543515417 __ret_70; \
1543615418})
1543715419#else
15438#define vmlsq_lane_s16(__p0_71, __p1_71, __p2_71, __p3_71) __extension__ ({ \
15439 int16x8_t __ret_71; \
15440 int16x8_t __s0_71 = __p0_71; \
15441 int16x8_t __s1_71 = __p1_71; \
15442 int16x4_t __s2_71 = __p2_71; \
15443 int16x8_t __rev0_71; __rev0_71 = __builtin_shufflevector(__s0_71, __s0_71, 7, 6, 5, 4, 3, 2, 1, 0); \
15444 int16x8_t __rev1_71; __rev1_71 = __builtin_shufflevector(__s1_71, __s1_71, 7, 6, 5, 4, 3, 2, 1, 0); \
15445 int16x4_t __rev2_71; __rev2_71 = __builtin_shufflevector(__s2_71, __s2_71, 3, 2, 1, 0); \
15446 __ret_71 = __rev0_71 - __rev1_71 * __noswap_splatq_lane_s16(__rev2_71, __p3_71); \
15447 __ret_71 = __builtin_shufflevector(__ret_71, __ret_71, 7, 6, 5, 4, 3, 2, 1, 0); \
15420#define vmlsq_lane_f32(__p0_71, __p1_71, __p2_71, __p3_71) __extension__ ({ \
15421 float32x4_t __ret_71; \
15422 float32x4_t __s0_71 = __p0_71; \
15423 float32x4_t __s1_71 = __p1_71; \
15424 float32x2_t __s2_71 = __p2_71; \
15425 float32x4_t __rev0_71; __rev0_71 = __builtin_shufflevector(__s0_71, __s0_71, 3, 2, 1, 0); \
15426 float32x4_t __rev1_71; __rev1_71 = __builtin_shufflevector(__s1_71, __s1_71, 3, 2, 1, 0); \
15427 float32x2_t __rev2_71; __rev2_71 = __builtin_shufflevector(__s2_71, __s2_71, 1, 0); \
15428 __ret_71 = __rev0_71 - __rev1_71 * __noswap_splatq_lane_f32(__rev2_71, __p3_71); \
15429 __ret_71 = __builtin_shufflevector(__ret_71, __ret_71, 3, 2, 1, 0); \
1544815430 __ret_71; \
1544915431})
1545015432#endif
1545115433
1545215434#ifdef __LITTLE_ENDIAN__
15453#define vmls_lane_u32(__p0_72, __p1_72, __p2_72, __p3_72) __extension__ ({ \
15454 uint32x2_t __ret_72; \
15455 uint32x2_t __s0_72 = __p0_72; \
15456 uint32x2_t __s1_72 = __p1_72; \
15457 uint32x2_t __s2_72 = __p2_72; \
15458 __ret_72 = __s0_72 - __s1_72 * splat_lane_u32(__s2_72, __p3_72); \
15435#define vmlsq_lane_s32(__p0_72, __p1_72, __p2_72, __p3_72) __extension__ ({ \
15436 int32x4_t __ret_72; \
15437 int32x4_t __s0_72 = __p0_72; \
15438 int32x4_t __s1_72 = __p1_72; \
15439 int32x2_t __s2_72 = __p2_72; \
15440 __ret_72 = __s0_72 - __s1_72 * splatq_lane_s32(__s2_72, __p3_72); \
1545915441 __ret_72; \
1546015442})
1546115443#else
15462#define vmls_lane_u32(__p0_73, __p1_73, __p2_73, __p3_73) __extension__ ({ \
15463 uint32x2_t __ret_73; \
15464 uint32x2_t __s0_73 = __p0_73; \
15465 uint32x2_t __s1_73 = __p1_73; \
15466 uint32x2_t __s2_73 = __p2_73; \
15467 uint32x2_t __rev0_73; __rev0_73 = __builtin_shufflevector(__s0_73, __s0_73, 1, 0); \
15468 uint32x2_t __rev1_73; __rev1_73 = __builtin_shufflevector(__s1_73, __s1_73, 1, 0); \
15469 uint32x2_t __rev2_73; __rev2_73 = __builtin_shufflevector(__s2_73, __s2_73, 1, 0); \
15470 __ret_73 = __rev0_73 - __rev1_73 * __noswap_splat_lane_u32(__rev2_73, __p3_73); \
15471 __ret_73 = __builtin_shufflevector(__ret_73, __ret_73, 1, 0); \
15444#define vmlsq_lane_s32(__p0_73, __p1_73, __p2_73, __p3_73) __extension__ ({ \
15445 int32x4_t __ret_73; \
15446 int32x4_t __s0_73 = __p0_73; \
15447 int32x4_t __s1_73 = __p1_73; \
15448 int32x2_t __s2_73 = __p2_73; \
15449 int32x4_t __rev0_73; __rev0_73 = __builtin_shufflevector(__s0_73, __s0_73, 3, 2, 1, 0); \
15450 int32x4_t __rev1_73; __rev1_73 = __builtin_shufflevector(__s1_73, __s1_73, 3, 2, 1, 0); \
15451 int32x2_t __rev2_73; __rev2_73 = __builtin_shufflevector(__s2_73, __s2_73, 1, 0); \
15452 __ret_73 = __rev0_73 - __rev1_73 * __noswap_splatq_lane_s32(__rev2_73, __p3_73); \
15453 __ret_73 = __builtin_shufflevector(__ret_73, __ret_73, 3, 2, 1, 0); \
1547215454 __ret_73; \
1547315455})
1547415456#endif
1547515457
1547615458#ifdef __LITTLE_ENDIAN__
15477#define vmls_lane_u16(__p0_74, __p1_74, __p2_74, __p3_74) __extension__ ({ \
15478 uint16x4_t __ret_74; \
15479 uint16x4_t __s0_74 = __p0_74; \
15480 uint16x4_t __s1_74 = __p1_74; \
15481 uint16x4_t __s2_74 = __p2_74; \
15482 __ret_74 = __s0_74 - __s1_74 * splat_lane_u16(__s2_74, __p3_74); \
15459#define vmlsq_lane_s16(__p0_74, __p1_74, __p2_74, __p3_74) __extension__ ({ \
15460 int16x8_t __ret_74; \
15461 int16x8_t __s0_74 = __p0_74; \
15462 int16x8_t __s1_74 = __p1_74; \
15463 int16x4_t __s2_74 = __p2_74; \
15464 __ret_74 = __s0_74 - __s1_74 * splatq_lane_s16(__s2_74, __p3_74); \
1548315465 __ret_74; \
1548415466})
1548515467#else
15486#define vmls_lane_u16(__p0_75, __p1_75, __p2_75, __p3_75) __extension__ ({ \
15487 uint16x4_t __ret_75; \
15488 uint16x4_t __s0_75 = __p0_75; \
15489 uint16x4_t __s1_75 = __p1_75; \
15490 uint16x4_t __s2_75 = __p2_75; \
15491 uint16x4_t __rev0_75; __rev0_75 = __builtin_shufflevector(__s0_75, __s0_75, 3, 2, 1, 0); \
15492 uint16x4_t __rev1_75; __rev1_75 = __builtin_shufflevector(__s1_75, __s1_75, 3, 2, 1, 0); \
15493 uint16x4_t __rev2_75; __rev2_75 = __builtin_shufflevector(__s2_75, __s2_75, 3, 2, 1, 0); \
15494 __ret_75 = __rev0_75 - __rev1_75 * __noswap_splat_lane_u16(__rev2_75, __p3_75); \
15495 __ret_75 = __builtin_shufflevector(__ret_75, __ret_75, 3, 2, 1, 0); \
15468#define vmlsq_lane_s16(__p0_75, __p1_75, __p2_75, __p3_75) __extension__ ({ \
15469 int16x8_t __ret_75; \
15470 int16x8_t __s0_75 = __p0_75; \
15471 int16x8_t __s1_75 = __p1_75; \
15472 int16x4_t __s2_75 = __p2_75; \
15473 int16x8_t __rev0_75; __rev0_75 = __builtin_shufflevector(__s0_75, __s0_75, 7, 6, 5, 4, 3, 2, 1, 0); \
15474 int16x8_t __rev1_75; __rev1_75 = __builtin_shufflevector(__s1_75, __s1_75, 7, 6, 5, 4, 3, 2, 1, 0); \
15475 int16x4_t __rev2_75; __rev2_75 = __builtin_shufflevector(__s2_75, __s2_75, 3, 2, 1, 0); \
15476 __ret_75 = __rev0_75 - __rev1_75 * __noswap_splatq_lane_s16(__rev2_75, __p3_75); \
15477 __ret_75 = __builtin_shufflevector(__ret_75, __ret_75, 7, 6, 5, 4, 3, 2, 1, 0); \
1549615478 __ret_75; \
1549715479})
1549815480#endif
1549915481
1550015482#ifdef __LITTLE_ENDIAN__
15501#define vmls_lane_f32(__p0_76, __p1_76, __p2_76, __p3_76) __extension__ ({ \
15502 float32x2_t __ret_76; \
15503 float32x2_t __s0_76 = __p0_76; \
15504 float32x2_t __s1_76 = __p1_76; \
15505 float32x2_t __s2_76 = __p2_76; \
15506 __ret_76 = __s0_76 - __s1_76 * splat_lane_f32(__s2_76, __p3_76); \
15483#define vmls_lane_u32(__p0_76, __p1_76, __p2_76, __p3_76) __extension__ ({ \
15484 uint32x2_t __ret_76; \
15485 uint32x2_t __s0_76 = __p0_76; \
15486 uint32x2_t __s1_76 = __p1_76; \
15487 uint32x2_t __s2_76 = __p2_76; \
15488 __ret_76 = __s0_76 - __s1_76 * splat_lane_u32(__s2_76, __p3_76); \
1550715489 __ret_76; \
1550815490})
1550915491#else
15510#define vmls_lane_f32(__p0_77, __p1_77, __p2_77, __p3_77) __extension__ ({ \
15511 float32x2_t __ret_77; \
15512 float32x2_t __s0_77 = __p0_77; \
15513 float32x2_t __s1_77 = __p1_77; \
15514 float32x2_t __s2_77 = __p2_77; \
15515 float32x2_t __rev0_77; __rev0_77 = __builtin_shufflevector(__s0_77, __s0_77, 1, 0); \
15516 float32x2_t __rev1_77; __rev1_77 = __builtin_shufflevector(__s1_77, __s1_77, 1, 0); \
15517 float32x2_t __rev2_77; __rev2_77 = __builtin_shufflevector(__s2_77, __s2_77, 1, 0); \
15518 __ret_77 = __rev0_77 - __rev1_77 * __noswap_splat_lane_f32(__rev2_77, __p3_77); \
15492#define vmls_lane_u32(__p0_77, __p1_77, __p2_77, __p3_77) __extension__ ({ \
15493 uint32x2_t __ret_77; \
15494 uint32x2_t __s0_77 = __p0_77; \
15495 uint32x2_t __s1_77 = __p1_77; \
15496 uint32x2_t __s2_77 = __p2_77; \
15497 uint32x2_t __rev0_77; __rev0_77 = __builtin_shufflevector(__s0_77, __s0_77, 1, 0); \
15498 uint32x2_t __rev1_77; __rev1_77 = __builtin_shufflevector(__s1_77, __s1_77, 1, 0); \
15499 uint32x2_t __rev2_77; __rev2_77 = __builtin_shufflevector(__s2_77, __s2_77, 1, 0); \
15500 __ret_77 = __rev0_77 - __rev1_77 * __noswap_splat_lane_u32(__rev2_77, __p3_77); \
1551915501 __ret_77 = __builtin_shufflevector(__ret_77, __ret_77, 1, 0); \
1552015502 __ret_77; \
1552115503})
1552215504#endif
1552315505
1552415506#ifdef __LITTLE_ENDIAN__
15525#define vmls_lane_s32(__p0_78, __p1_78, __p2_78, __p3_78) __extension__ ({ \
15526 int32x2_t __ret_78; \
15527 int32x2_t __s0_78 = __p0_78; \
15528 int32x2_t __s1_78 = __p1_78; \
15529 int32x2_t __s2_78 = __p2_78; \
15530 __ret_78 = __s0_78 - __s1_78 * splat_lane_s32(__s2_78, __p3_78); \
15507#define vmls_lane_u16(__p0_78, __p1_78, __p2_78, __p3_78) __extension__ ({ \
15508 uint16x4_t __ret_78; \
15509 uint16x4_t __s0_78 = __p0_78; \
15510 uint16x4_t __s1_78 = __p1_78; \
15511 uint16x4_t __s2_78 = __p2_78; \
15512 __ret_78 = __s0_78 - __s1_78 * splat_lane_u16(__s2_78, __p3_78); \
1553115513 __ret_78; \
1553215514})
1553315515#else
15534#define vmls_lane_s32(__p0_79, __p1_79, __p2_79, __p3_79) __extension__ ({ \
15535 int32x2_t __ret_79; \
15536 int32x2_t __s0_79 = __p0_79; \
15537 int32x2_t __s1_79 = __p1_79; \
15538 int32x2_t __s2_79 = __p2_79; \
15539 int32x2_t __rev0_79; __rev0_79 = __builtin_shufflevector(__s0_79, __s0_79, 1, 0); \
15540 int32x2_t __rev1_79; __rev1_79 = __builtin_shufflevector(__s1_79, __s1_79, 1, 0); \
15541 int32x2_t __rev2_79; __rev2_79 = __builtin_shufflevector(__s2_79, __s2_79, 1, 0); \
15542 __ret_79 = __rev0_79 - __rev1_79 * __noswap_splat_lane_s32(__rev2_79, __p3_79); \
15543 __ret_79 = __builtin_shufflevector(__ret_79, __ret_79, 1, 0); \
15516#define vmls_lane_u16(__p0_79, __p1_79, __p2_79, __p3_79) __extension__ ({ \
15517 uint16x4_t __ret_79; \
15518 uint16x4_t __s0_79 = __p0_79; \
15519 uint16x4_t __s1_79 = __p1_79; \
15520 uint16x4_t __s2_79 = __p2_79; \
15521 uint16x4_t __rev0_79; __rev0_79 = __builtin_shufflevector(__s0_79, __s0_79, 3, 2, 1, 0); \
15522 uint16x4_t __rev1_79; __rev1_79 = __builtin_shufflevector(__s1_79, __s1_79, 3, 2, 1, 0); \
15523 uint16x4_t __rev2_79; __rev2_79 = __builtin_shufflevector(__s2_79, __s2_79, 3, 2, 1, 0); \
15524 __ret_79 = __rev0_79 - __rev1_79 * __noswap_splat_lane_u16(__rev2_79, __p3_79); \
15525 __ret_79 = __builtin_shufflevector(__ret_79, __ret_79, 3, 2, 1, 0); \
1554415526 __ret_79; \
1554515527})
1554615528#endif
1554715529
1554815530#ifdef __LITTLE_ENDIAN__
15549#define vmls_lane_s16(__p0_80, __p1_80, __p2_80, __p3_80) __extension__ ({ \
15550 int16x4_t __ret_80; \
15551 int16x4_t __s0_80 = __p0_80; \
15552 int16x4_t __s1_80 = __p1_80; \
15553 int16x4_t __s2_80 = __p2_80; \
15554 __ret_80 = __s0_80 - __s1_80 * splat_lane_s16(__s2_80, __p3_80); \
15531#define vmls_lane_f32(__p0_80, __p1_80, __p2_80, __p3_80) __extension__ ({ \
15532 float32x2_t __ret_80; \
15533 float32x2_t __s0_80 = __p0_80; \
15534 float32x2_t __s1_80 = __p1_80; \
15535 float32x2_t __s2_80 = __p2_80; \
15536 __ret_80 = __s0_80 - __s1_80 * splat_lane_f32(__s2_80, __p3_80); \
1555515537 __ret_80; \
1555615538})
1555715539#else
15558#define vmls_lane_s16(__p0_81, __p1_81, __p2_81, __p3_81) __extension__ ({ \
15559 int16x4_t __ret_81; \
15560 int16x4_t __s0_81 = __p0_81; \
15561 int16x4_t __s1_81 = __p1_81; \
15562 int16x4_t __s2_81 = __p2_81; \
15563 int16x4_t __rev0_81; __rev0_81 = __builtin_shufflevector(__s0_81, __s0_81, 3, 2, 1, 0); \
15564 int16x4_t __rev1_81; __rev1_81 = __builtin_shufflevector(__s1_81, __s1_81, 3, 2, 1, 0); \
15565 int16x4_t __rev2_81; __rev2_81 = __builtin_shufflevector(__s2_81, __s2_81, 3, 2, 1, 0); \
15566 __ret_81 = __rev0_81 - __rev1_81 * __noswap_splat_lane_s16(__rev2_81, __p3_81); \
15567 __ret_81 = __builtin_shufflevector(__ret_81, __ret_81, 3, 2, 1, 0); \
15540#define vmls_lane_f32(__p0_81, __p1_81, __p2_81, __p3_81) __extension__ ({ \
15541 float32x2_t __ret_81; \
15542 float32x2_t __s0_81 = __p0_81; \
15543 float32x2_t __s1_81 = __p1_81; \
15544 float32x2_t __s2_81 = __p2_81; \
15545 float32x2_t __rev0_81; __rev0_81 = __builtin_shufflevector(__s0_81, __s0_81, 1, 0); \
15546 float32x2_t __rev1_81; __rev1_81 = __builtin_shufflevector(__s1_81, __s1_81, 1, 0); \
15547 float32x2_t __rev2_81; __rev2_81 = __builtin_shufflevector(__s2_81, __s2_81, 1, 0); \
15548 __ret_81 = __rev0_81 - __rev1_81 * __noswap_splat_lane_f32(__rev2_81, __p3_81); \
15549 __ret_81 = __builtin_shufflevector(__ret_81, __ret_81, 1, 0); \
1556815550 __ret_81; \
1556915551})
1557015552#endif
1557115553
15554#ifdef __LITTLE_ENDIAN__
15555#define vmls_lane_s32(__p0_82, __p1_82, __p2_82, __p3_82) __extension__ ({ \
15556 int32x2_t __ret_82; \
15557 int32x2_t __s0_82 = __p0_82; \
15558 int32x2_t __s1_82 = __p1_82; \
15559 int32x2_t __s2_82 = __p2_82; \
15560 __ret_82 = __s0_82 - __s1_82 * splat_lane_s32(__s2_82, __p3_82); \
15561 __ret_82; \
15562})
15563#else
15564#define vmls_lane_s32(__p0_83, __p1_83, __p2_83, __p3_83) __extension__ ({ \
15565 int32x2_t __ret_83; \
15566 int32x2_t __s0_83 = __p0_83; \
15567 int32x2_t __s1_83 = __p1_83; \
15568 int32x2_t __s2_83 = __p2_83; \
15569 int32x2_t __rev0_83; __rev0_83 = __builtin_shufflevector(__s0_83, __s0_83, 1, 0); \
15570 int32x2_t __rev1_83; __rev1_83 = __builtin_shufflevector(__s1_83, __s1_83, 1, 0); \
15571 int32x2_t __rev2_83; __rev2_83 = __builtin_shufflevector(__s2_83, __s2_83, 1, 0); \
15572 __ret_83 = __rev0_83 - __rev1_83 * __noswap_splat_lane_s32(__rev2_83, __p3_83); \
15573 __ret_83 = __builtin_shufflevector(__ret_83, __ret_83, 1, 0); \
15574 __ret_83; \
15575})
15576#endif
15577
15578#ifdef __LITTLE_ENDIAN__
15579#define vmls_lane_s16(__p0_84, __p1_84, __p2_84, __p3_84) __extension__ ({ \
15580 int16x4_t __ret_84; \
15581 int16x4_t __s0_84 = __p0_84; \
15582 int16x4_t __s1_84 = __p1_84; \
15583 int16x4_t __s2_84 = __p2_84; \
15584 __ret_84 = __s0_84 - __s1_84 * splat_lane_s16(__s2_84, __p3_84); \
15585 __ret_84; \
15586})
15587#else
15588#define vmls_lane_s16(__p0_85, __p1_85, __p2_85, __p3_85) __extension__ ({ \
15589 int16x4_t __ret_85; \
15590 int16x4_t __s0_85 = __p0_85; \
15591 int16x4_t __s1_85 = __p1_85; \
15592 int16x4_t __s2_85 = __p2_85; \
15593 int16x4_t __rev0_85; __rev0_85 = __builtin_shufflevector(__s0_85, __s0_85, 3, 2, 1, 0); \
15594 int16x4_t __rev1_85; __rev1_85 = __builtin_shufflevector(__s1_85, __s1_85, 3, 2, 1, 0); \
15595 int16x4_t __rev2_85; __rev2_85 = __builtin_shufflevector(__s2_85, __s2_85, 3, 2, 1, 0); \
15596 __ret_85 = __rev0_85 - __rev1_85 * __noswap_splat_lane_s16(__rev2_85, __p3_85); \
15597 __ret_85 = __builtin_shufflevector(__ret_85, __ret_85, 3, 2, 1, 0); \
15598 __ret_85; \
15599})
15600#endif
15601
1557215602#ifdef __LITTLE_ENDIAN__
1557315603__ai uint32x4_t vmlsq_n_u32(uint32x4_t __p0, uint32x4_t __p1, uint32_t __p2) {
1557415604 uint32x4_t __ret;
......@@ -16608,215 +16638,215 @@ __ai poly8x16_t vmulq_p8(poly8x16_t __p0, poly8x16_t __p1) {
1660816638#endif
1660916639
1661016640#ifdef __LITTLE_ENDIAN__
16611#define vmulq_lane_u32(__p0_82, __p1_82, __p2_82) __extension__ ({ \
16612 uint32x4_t __ret_82; \
16613 uint32x4_t __s0_82 = __p0_82; \
16614 uint32x2_t __s1_82 = __p1_82; \
16615 __ret_82 = __s0_82 * splatq_lane_u32(__s1_82, __p2_82); \
16616 __ret_82; \
16617})
16618#else
16619#define vmulq_lane_u32(__p0_83, __p1_83, __p2_83) __extension__ ({ \
16620 uint32x4_t __ret_83; \
16621 uint32x4_t __s0_83 = __p0_83; \
16622 uint32x2_t __s1_83 = __p1_83; \
16623 uint32x4_t __rev0_83; __rev0_83 = __builtin_shufflevector(__s0_83, __s0_83, 3, 2, 1, 0); \
16624 uint32x2_t __rev1_83; __rev1_83 = __builtin_shufflevector(__s1_83, __s1_83, 1, 0); \
16625 __ret_83 = __rev0_83 * __noswap_splatq_lane_u32(__rev1_83, __p2_83); \
16626 __ret_83 = __builtin_shufflevector(__ret_83, __ret_83, 3, 2, 1, 0); \
16627 __ret_83; \
16628})
16629#endif
16630
16631#ifdef __LITTLE_ENDIAN__
16632#define vmulq_lane_u16(__p0_84, __p1_84, __p2_84) __extension__ ({ \
16633 uint16x8_t __ret_84; \
16634 uint16x8_t __s0_84 = __p0_84; \
16635 uint16x4_t __s1_84 = __p1_84; \
16636 __ret_84 = __s0_84 * splatq_lane_u16(__s1_84, __p2_84); \
16637 __ret_84; \
16638})
16639#else
16640#define vmulq_lane_u16(__p0_85, __p1_85, __p2_85) __extension__ ({ \
16641 uint16x8_t __ret_85; \
16642 uint16x8_t __s0_85 = __p0_85; \
16643 uint16x4_t __s1_85 = __p1_85; \
16644 uint16x8_t __rev0_85; __rev0_85 = __builtin_shufflevector(__s0_85, __s0_85, 7, 6, 5, 4, 3, 2, 1, 0); \
16645 uint16x4_t __rev1_85; __rev1_85 = __builtin_shufflevector(__s1_85, __s1_85, 3, 2, 1, 0); \
16646 __ret_85 = __rev0_85 * __noswap_splatq_lane_u16(__rev1_85, __p2_85); \
16647 __ret_85 = __builtin_shufflevector(__ret_85, __ret_85, 7, 6, 5, 4, 3, 2, 1, 0); \
16648 __ret_85; \
16649})
16650#endif
16651
16652#ifdef __LITTLE_ENDIAN__
16653#define vmulq_lane_f32(__p0_86, __p1_86, __p2_86) __extension__ ({ \
16654 float32x4_t __ret_86; \
16655 float32x4_t __s0_86 = __p0_86; \
16656 float32x2_t __s1_86 = __p1_86; \
16657 __ret_86 = __s0_86 * splatq_lane_f32(__s1_86, __p2_86); \
16641#define vmulq_lane_u32(__p0_86, __p1_86, __p2_86) __extension__ ({ \
16642 uint32x4_t __ret_86; \
16643 uint32x4_t __s0_86 = __p0_86; \
16644 uint32x2_t __s1_86 = __p1_86; \
16645 __ret_86 = __s0_86 * splatq_lane_u32(__s1_86, __p2_86); \
1665816646 __ret_86; \
1665916647})
1666016648#else
16661#define vmulq_lane_f32(__p0_87, __p1_87, __p2_87) __extension__ ({ \
16662 float32x4_t __ret_87; \
16663 float32x4_t __s0_87 = __p0_87; \
16664 float32x2_t __s1_87 = __p1_87; \
16665 float32x4_t __rev0_87; __rev0_87 = __builtin_shufflevector(__s0_87, __s0_87, 3, 2, 1, 0); \
16666 float32x2_t __rev1_87; __rev1_87 = __builtin_shufflevector(__s1_87, __s1_87, 1, 0); \
16667 __ret_87 = __rev0_87 * __noswap_splatq_lane_f32(__rev1_87, __p2_87); \
16649#define vmulq_lane_u32(__p0_87, __p1_87, __p2_87) __extension__ ({ \
16650 uint32x4_t __ret_87; \
16651 uint32x4_t __s0_87 = __p0_87; \
16652 uint32x2_t __s1_87 = __p1_87; \
16653 uint32x4_t __rev0_87; __rev0_87 = __builtin_shufflevector(__s0_87, __s0_87, 3, 2, 1, 0); \
16654 uint32x2_t __rev1_87; __rev1_87 = __builtin_shufflevector(__s1_87, __s1_87, 1, 0); \
16655 __ret_87 = __rev0_87 * __noswap_splatq_lane_u32(__rev1_87, __p2_87); \
1666816656 __ret_87 = __builtin_shufflevector(__ret_87, __ret_87, 3, 2, 1, 0); \
1666916657 __ret_87; \
1667016658})
1667116659#endif
1667216660
1667316661#ifdef __LITTLE_ENDIAN__
16674#define vmulq_lane_s32(__p0_88, __p1_88, __p2_88) __extension__ ({ \
16675 int32x4_t __ret_88; \
16676 int32x4_t __s0_88 = __p0_88; \
16677 int32x2_t __s1_88 = __p1_88; \
16678 __ret_88 = __s0_88 * splatq_lane_s32(__s1_88, __p2_88); \
16662#define vmulq_lane_u16(__p0_88, __p1_88, __p2_88) __extension__ ({ \
16663 uint16x8_t __ret_88; \
16664 uint16x8_t __s0_88 = __p0_88; \
16665 uint16x4_t __s1_88 = __p1_88; \
16666 __ret_88 = __s0_88 * splatq_lane_u16(__s1_88, __p2_88); \
1667916667 __ret_88; \
1668016668})
1668116669#else
16682#define vmulq_lane_s32(__p0_89, __p1_89, __p2_89) __extension__ ({ \
16683 int32x4_t __ret_89; \
16684 int32x4_t __s0_89 = __p0_89; \
16685 int32x2_t __s1_89 = __p1_89; \
16686 int32x4_t __rev0_89; __rev0_89 = __builtin_shufflevector(__s0_89, __s0_89, 3, 2, 1, 0); \
16687 int32x2_t __rev1_89; __rev1_89 = __builtin_shufflevector(__s1_89, __s1_89, 1, 0); \
16688 __ret_89 = __rev0_89 * __noswap_splatq_lane_s32(__rev1_89, __p2_89); \
16689 __ret_89 = __builtin_shufflevector(__ret_89, __ret_89, 3, 2, 1, 0); \
16670#define vmulq_lane_u16(__p0_89, __p1_89, __p2_89) __extension__ ({ \
16671 uint16x8_t __ret_89; \
16672 uint16x8_t __s0_89 = __p0_89; \
16673 uint16x4_t __s1_89 = __p1_89; \
16674 uint16x8_t __rev0_89; __rev0_89 = __builtin_shufflevector(__s0_89, __s0_89, 7, 6, 5, 4, 3, 2, 1, 0); \
16675 uint16x4_t __rev1_89; __rev1_89 = __builtin_shufflevector(__s1_89, __s1_89, 3, 2, 1, 0); \
16676 __ret_89 = __rev0_89 * __noswap_splatq_lane_u16(__rev1_89, __p2_89); \
16677 __ret_89 = __builtin_shufflevector(__ret_89, __ret_89, 7, 6, 5, 4, 3, 2, 1, 0); \
1669016678 __ret_89; \
1669116679})
1669216680#endif
1669316681
1669416682#ifdef __LITTLE_ENDIAN__
16695#define vmulq_lane_s16(__p0_90, __p1_90, __p2_90) __extension__ ({ \
16696 int16x8_t __ret_90; \
16697 int16x8_t __s0_90 = __p0_90; \
16698 int16x4_t __s1_90 = __p1_90; \
16699 __ret_90 = __s0_90 * splatq_lane_s16(__s1_90, __p2_90); \
16683#define vmulq_lane_f32(__p0_90, __p1_90, __p2_90) __extension__ ({ \
16684 float32x4_t __ret_90; \
16685 float32x4_t __s0_90 = __p0_90; \
16686 float32x2_t __s1_90 = __p1_90; \
16687 __ret_90 = __s0_90 * splatq_lane_f32(__s1_90, __p2_90); \
1670016688 __ret_90; \
1670116689})
1670216690#else
16703#define vmulq_lane_s16(__p0_91, __p1_91, __p2_91) __extension__ ({ \
16704 int16x8_t __ret_91; \
16705 int16x8_t __s0_91 = __p0_91; \
16706 int16x4_t __s1_91 = __p1_91; \
16707 int16x8_t __rev0_91; __rev0_91 = __builtin_shufflevector(__s0_91, __s0_91, 7, 6, 5, 4, 3, 2, 1, 0); \
16708 int16x4_t __rev1_91; __rev1_91 = __builtin_shufflevector(__s1_91, __s1_91, 3, 2, 1, 0); \
16709 __ret_91 = __rev0_91 * __noswap_splatq_lane_s16(__rev1_91, __p2_91); \
16710 __ret_91 = __builtin_shufflevector(__ret_91, __ret_91, 7, 6, 5, 4, 3, 2, 1, 0); \
16691#define vmulq_lane_f32(__p0_91, __p1_91, __p2_91) __extension__ ({ \
16692 float32x4_t __ret_91; \
16693 float32x4_t __s0_91 = __p0_91; \
16694 float32x2_t __s1_91 = __p1_91; \
16695 float32x4_t __rev0_91; __rev0_91 = __builtin_shufflevector(__s0_91, __s0_91, 3, 2, 1, 0); \
16696 float32x2_t __rev1_91; __rev1_91 = __builtin_shufflevector(__s1_91, __s1_91, 1, 0); \
16697 __ret_91 = __rev0_91 * __noswap_splatq_lane_f32(__rev1_91, __p2_91); \
16698 __ret_91 = __builtin_shufflevector(__ret_91, __ret_91, 3, 2, 1, 0); \
1671116699 __ret_91; \
1671216700})
1671316701#endif
1671416702
1671516703#ifdef __LITTLE_ENDIAN__
16716#define vmul_lane_u32(__p0_92, __p1_92, __p2_92) __extension__ ({ \
16717 uint32x2_t __ret_92; \
16718 uint32x2_t __s0_92 = __p0_92; \
16719 uint32x2_t __s1_92 = __p1_92; \
16720 __ret_92 = __s0_92 * splat_lane_u32(__s1_92, __p2_92); \
16704#define vmulq_lane_s32(__p0_92, __p1_92, __p2_92) __extension__ ({ \
16705 int32x4_t __ret_92; \
16706 int32x4_t __s0_92 = __p0_92; \
16707 int32x2_t __s1_92 = __p1_92; \
16708 __ret_92 = __s0_92 * splatq_lane_s32(__s1_92, __p2_92); \
1672116709 __ret_92; \
1672216710})
1672316711#else
16724#define vmul_lane_u32(__p0_93, __p1_93, __p2_93) __extension__ ({ \
16725 uint32x2_t __ret_93; \
16726 uint32x2_t __s0_93 = __p0_93; \
16727 uint32x2_t __s1_93 = __p1_93; \
16728 uint32x2_t __rev0_93; __rev0_93 = __builtin_shufflevector(__s0_93, __s0_93, 1, 0); \
16729 uint32x2_t __rev1_93; __rev1_93 = __builtin_shufflevector(__s1_93, __s1_93, 1, 0); \
16730 __ret_93 = __rev0_93 * __noswap_splat_lane_u32(__rev1_93, __p2_93); \
16731 __ret_93 = __builtin_shufflevector(__ret_93, __ret_93, 1, 0); \
16712#define vmulq_lane_s32(__p0_93, __p1_93, __p2_93) __extension__ ({ \
16713 int32x4_t __ret_93; \
16714 int32x4_t __s0_93 = __p0_93; \
16715 int32x2_t __s1_93 = __p1_93; \
16716 int32x4_t __rev0_93; __rev0_93 = __builtin_shufflevector(__s0_93, __s0_93, 3, 2, 1, 0); \
16717 int32x2_t __rev1_93; __rev1_93 = __builtin_shufflevector(__s1_93, __s1_93, 1, 0); \
16718 __ret_93 = __rev0_93 * __noswap_splatq_lane_s32(__rev1_93, __p2_93); \
16719 __ret_93 = __builtin_shufflevector(__ret_93, __ret_93, 3, 2, 1, 0); \
1673216720 __ret_93; \
1673316721})
1673416722#endif
1673516723
1673616724#ifdef __LITTLE_ENDIAN__
16737#define vmul_lane_u16(__p0_94, __p1_94, __p2_94) __extension__ ({ \
16738 uint16x4_t __ret_94; \
16739 uint16x4_t __s0_94 = __p0_94; \
16740 uint16x4_t __s1_94 = __p1_94; \
16741 __ret_94 = __s0_94 * splat_lane_u16(__s1_94, __p2_94); \
16725#define vmulq_lane_s16(__p0_94, __p1_94, __p2_94) __extension__ ({ \
16726 int16x8_t __ret_94; \
16727 int16x8_t __s0_94 = __p0_94; \
16728 int16x4_t __s1_94 = __p1_94; \
16729 __ret_94 = __s0_94 * splatq_lane_s16(__s1_94, __p2_94); \
1674216730 __ret_94; \
1674316731})
1674416732#else
16745#define vmul_lane_u16(__p0_95, __p1_95, __p2_95) __extension__ ({ \
16746 uint16x4_t __ret_95; \
16747 uint16x4_t __s0_95 = __p0_95; \
16748 uint16x4_t __s1_95 = __p1_95; \
16749 uint16x4_t __rev0_95; __rev0_95 = __builtin_shufflevector(__s0_95, __s0_95, 3, 2, 1, 0); \
16750 uint16x4_t __rev1_95; __rev1_95 = __builtin_shufflevector(__s1_95, __s1_95, 3, 2, 1, 0); \
16751 __ret_95 = __rev0_95 * __noswap_splat_lane_u16(__rev1_95, __p2_95); \
16752 __ret_95 = __builtin_shufflevector(__ret_95, __ret_95, 3, 2, 1, 0); \
16733#define vmulq_lane_s16(__p0_95, __p1_95, __p2_95) __extension__ ({ \
16734 int16x8_t __ret_95; \
16735 int16x8_t __s0_95 = __p0_95; \
16736 int16x4_t __s1_95 = __p1_95; \
16737 int16x8_t __rev0_95; __rev0_95 = __builtin_shufflevector(__s0_95, __s0_95, 7, 6, 5, 4, 3, 2, 1, 0); \
16738 int16x4_t __rev1_95; __rev1_95 = __builtin_shufflevector(__s1_95, __s1_95, 3, 2, 1, 0); \
16739 __ret_95 = __rev0_95 * __noswap_splatq_lane_s16(__rev1_95, __p2_95); \
16740 __ret_95 = __builtin_shufflevector(__ret_95, __ret_95, 7, 6, 5, 4, 3, 2, 1, 0); \
1675316741 __ret_95; \
1675416742})
1675516743#endif
1675616744
1675716745#ifdef __LITTLE_ENDIAN__
16758#define vmul_lane_f32(__p0_96, __p1_96, __p2_96) __extension__ ({ \
16759 float32x2_t __ret_96; \
16760 float32x2_t __s0_96 = __p0_96; \
16761 float32x2_t __s1_96 = __p1_96; \
16762 __ret_96 = __s0_96 * splat_lane_f32(__s1_96, __p2_96); \
16746#define vmul_lane_u32(__p0_96, __p1_96, __p2_96) __extension__ ({ \
16747 uint32x2_t __ret_96; \
16748 uint32x2_t __s0_96 = __p0_96; \
16749 uint32x2_t __s1_96 = __p1_96; \
16750 __ret_96 = __s0_96 * splat_lane_u32(__s1_96, __p2_96); \
1676316751 __ret_96; \
1676416752})
1676516753#else
16766#define vmul_lane_f32(__p0_97, __p1_97, __p2_97) __extension__ ({ \
16767 float32x2_t __ret_97; \
16768 float32x2_t __s0_97 = __p0_97; \
16769 float32x2_t __s1_97 = __p1_97; \
16770 float32x2_t __rev0_97; __rev0_97 = __builtin_shufflevector(__s0_97, __s0_97, 1, 0); \
16771 float32x2_t __rev1_97; __rev1_97 = __builtin_shufflevector(__s1_97, __s1_97, 1, 0); \
16772 __ret_97 = __rev0_97 * __noswap_splat_lane_f32(__rev1_97, __p2_97); \
16754#define vmul_lane_u32(__p0_97, __p1_97, __p2_97) __extension__ ({ \
16755 uint32x2_t __ret_97; \
16756 uint32x2_t __s0_97 = __p0_97; \
16757 uint32x2_t __s1_97 = __p1_97; \
16758 uint32x2_t __rev0_97; __rev0_97 = __builtin_shufflevector(__s0_97, __s0_97, 1, 0); \
16759 uint32x2_t __rev1_97; __rev1_97 = __builtin_shufflevector(__s1_97, __s1_97, 1, 0); \
16760 __ret_97 = __rev0_97 * __noswap_splat_lane_u32(__rev1_97, __p2_97); \
1677316761 __ret_97 = __builtin_shufflevector(__ret_97, __ret_97, 1, 0); \
1677416762 __ret_97; \
1677516763})
1677616764#endif
1677716765
1677816766#ifdef __LITTLE_ENDIAN__
16779#define vmul_lane_s32(__p0_98, __p1_98, __p2_98) __extension__ ({ \
16780 int32x2_t __ret_98; \
16781 int32x2_t __s0_98 = __p0_98; \
16782 int32x2_t __s1_98 = __p1_98; \
16783 __ret_98 = __s0_98 * splat_lane_s32(__s1_98, __p2_98); \
16767#define vmul_lane_u16(__p0_98, __p1_98, __p2_98) __extension__ ({ \
16768 uint16x4_t __ret_98; \
16769 uint16x4_t __s0_98 = __p0_98; \
16770 uint16x4_t __s1_98 = __p1_98; \
16771 __ret_98 = __s0_98 * splat_lane_u16(__s1_98, __p2_98); \
1678416772 __ret_98; \
1678516773})
1678616774#else
16787#define vmul_lane_s32(__p0_99, __p1_99, __p2_99) __extension__ ({ \
16788 int32x2_t __ret_99; \
16789 int32x2_t __s0_99 = __p0_99; \
16790 int32x2_t __s1_99 = __p1_99; \
16791 int32x2_t __rev0_99; __rev0_99 = __builtin_shufflevector(__s0_99, __s0_99, 1, 0); \
16792 int32x2_t __rev1_99; __rev1_99 = __builtin_shufflevector(__s1_99, __s1_99, 1, 0); \
16793 __ret_99 = __rev0_99 * __noswap_splat_lane_s32(__rev1_99, __p2_99); \
16794 __ret_99 = __builtin_shufflevector(__ret_99, __ret_99, 1, 0); \
16775#define vmul_lane_u16(__p0_99, __p1_99, __p2_99) __extension__ ({ \
16776 uint16x4_t __ret_99; \
16777 uint16x4_t __s0_99 = __p0_99; \
16778 uint16x4_t __s1_99 = __p1_99; \
16779 uint16x4_t __rev0_99; __rev0_99 = __builtin_shufflevector(__s0_99, __s0_99, 3, 2, 1, 0); \
16780 uint16x4_t __rev1_99; __rev1_99 = __builtin_shufflevector(__s1_99, __s1_99, 3, 2, 1, 0); \
16781 __ret_99 = __rev0_99 * __noswap_splat_lane_u16(__rev1_99, __p2_99); \
16782 __ret_99 = __builtin_shufflevector(__ret_99, __ret_99, 3, 2, 1, 0); \
1679516783 __ret_99; \
1679616784})
1679716785#endif
1679816786
1679916787#ifdef __LITTLE_ENDIAN__
16800#define vmul_lane_s16(__p0_100, __p1_100, __p2_100) __extension__ ({ \
16801 int16x4_t __ret_100; \
16802 int16x4_t __s0_100 = __p0_100; \
16803 int16x4_t __s1_100 = __p1_100; \
16804 __ret_100 = __s0_100 * splat_lane_s16(__s1_100, __p2_100); \
16788#define vmul_lane_f32(__p0_100, __p1_100, __p2_100) __extension__ ({ \
16789 float32x2_t __ret_100; \
16790 float32x2_t __s0_100 = __p0_100; \
16791 float32x2_t __s1_100 = __p1_100; \
16792 __ret_100 = __s0_100 * splat_lane_f32(__s1_100, __p2_100); \
1680516793 __ret_100; \
1680616794})
1680716795#else
16808#define vmul_lane_s16(__p0_101, __p1_101, __p2_101) __extension__ ({ \
16809 int16x4_t __ret_101; \
16810 int16x4_t __s0_101 = __p0_101; \
16811 int16x4_t __s1_101 = __p1_101; \
16812 int16x4_t __rev0_101; __rev0_101 = __builtin_shufflevector(__s0_101, __s0_101, 3, 2, 1, 0); \
16813 int16x4_t __rev1_101; __rev1_101 = __builtin_shufflevector(__s1_101, __s1_101, 3, 2, 1, 0); \
16814 __ret_101 = __rev0_101 * __noswap_splat_lane_s16(__rev1_101, __p2_101); \
16815 __ret_101 = __builtin_shufflevector(__ret_101, __ret_101, 3, 2, 1, 0); \
16796#define vmul_lane_f32(__p0_101, __p1_101, __p2_101) __extension__ ({ \
16797 float32x2_t __ret_101; \
16798 float32x2_t __s0_101 = __p0_101; \
16799 float32x2_t __s1_101 = __p1_101; \
16800 float32x2_t __rev0_101; __rev0_101 = __builtin_shufflevector(__s0_101, __s0_101, 1, 0); \
16801 float32x2_t __rev1_101; __rev1_101 = __builtin_shufflevector(__s1_101, __s1_101, 1, 0); \
16802 __ret_101 = __rev0_101 * __noswap_splat_lane_f32(__rev1_101, __p2_101); \
16803 __ret_101 = __builtin_shufflevector(__ret_101, __ret_101, 1, 0); \
1681616804 __ret_101; \
1681716805})
1681816806#endif
1681916807
16808#ifdef __LITTLE_ENDIAN__
16809#define vmul_lane_s32(__p0_102, __p1_102, __p2_102) __extension__ ({ \
16810 int32x2_t __ret_102; \
16811 int32x2_t __s0_102 = __p0_102; \
16812 int32x2_t __s1_102 = __p1_102; \
16813 __ret_102 = __s0_102 * splat_lane_s32(__s1_102, __p2_102); \
16814 __ret_102; \
16815})
16816#else
16817#define vmul_lane_s32(__p0_103, __p1_103, __p2_103) __extension__ ({ \
16818 int32x2_t __ret_103; \
16819 int32x2_t __s0_103 = __p0_103; \
16820 int32x2_t __s1_103 = __p1_103; \
16821 int32x2_t __rev0_103; __rev0_103 = __builtin_shufflevector(__s0_103, __s0_103, 1, 0); \
16822 int32x2_t __rev1_103; __rev1_103 = __builtin_shufflevector(__s1_103, __s1_103, 1, 0); \
16823 __ret_103 = __rev0_103 * __noswap_splat_lane_s32(__rev1_103, __p2_103); \
16824 __ret_103 = __builtin_shufflevector(__ret_103, __ret_103, 1, 0); \
16825 __ret_103; \
16826})
16827#endif
16828
16829#ifdef __LITTLE_ENDIAN__
16830#define vmul_lane_s16(__p0_104, __p1_104, __p2_104) __extension__ ({ \
16831 int16x4_t __ret_104; \
16832 int16x4_t __s0_104 = __p0_104; \
16833 int16x4_t __s1_104 = __p1_104; \
16834 __ret_104 = __s0_104 * splat_lane_s16(__s1_104, __p2_104); \
16835 __ret_104; \
16836})
16837#else
16838#define vmul_lane_s16(__p0_105, __p1_105, __p2_105) __extension__ ({ \
16839 int16x4_t __ret_105; \
16840 int16x4_t __s0_105 = __p0_105; \
16841 int16x4_t __s1_105 = __p1_105; \
16842 int16x4_t __rev0_105; __rev0_105 = __builtin_shufflevector(__s0_105, __s0_105, 3, 2, 1, 0); \
16843 int16x4_t __rev1_105; __rev1_105 = __builtin_shufflevector(__s1_105, __s1_105, 3, 2, 1, 0); \
16844 __ret_105 = __rev0_105 * __noswap_splat_lane_s16(__rev1_105, __p2_105); \
16845 __ret_105 = __builtin_shufflevector(__ret_105, __ret_105, 3, 2, 1, 0); \
16846 __ret_105; \
16847})
16848#endif
16849
1682016850#ifdef __LITTLE_ENDIAN__
1682116851__ai uint32x4_t vmulq_n_u32(uint32x4_t __p0, uint32_t __p1) {
1682216852 uint32x4_t __ret;
......@@ -17132,86 +17162,86 @@ __ai int32x4_t __noswap_vmull_s16(int16x4_t __p0, int16x4_t __p1) {
1713217162#endif
1713317163
1713417164#ifdef __LITTLE_ENDIAN__
17135#define vmull_lane_u32(__p0_102, __p1_102, __p2_102) __extension__ ({ \
17136 uint64x2_t __ret_102; \
17137 uint32x2_t __s0_102 = __p0_102; \
17138 uint32x2_t __s1_102 = __p1_102; \
17139 __ret_102 = vmull_u32(__s0_102, splat_lane_u32(__s1_102, __p2_102)); \
17140 __ret_102; \
17165#define vmull_lane_u32(__p0_106, __p1_106, __p2_106) __extension__ ({ \
17166 uint64x2_t __ret_106; \
17167 uint32x2_t __s0_106 = __p0_106; \
17168 uint32x2_t __s1_106 = __p1_106; \
17169 __ret_106 = vmull_u32(__s0_106, splat_lane_u32(__s1_106, __p2_106)); \
17170 __ret_106; \
1714117171})
1714217172#else
17143#define vmull_lane_u32(__p0_103, __p1_103, __p2_103) __extension__ ({ \
17144 uint64x2_t __ret_103; \
17145 uint32x2_t __s0_103 = __p0_103; \
17146 uint32x2_t __s1_103 = __p1_103; \
17147 uint32x2_t __rev0_103; __rev0_103 = __builtin_shufflevector(__s0_103, __s0_103, 1, 0); \
17148 uint32x2_t __rev1_103; __rev1_103 = __builtin_shufflevector(__s1_103, __s1_103, 1, 0); \
17149 __ret_103 = __noswap_vmull_u32(__rev0_103, __noswap_splat_lane_u32(__rev1_103, __p2_103)); \
17150 __ret_103 = __builtin_shufflevector(__ret_103, __ret_103, 1, 0); \
17151 __ret_103; \
17173#define vmull_lane_u32(__p0_107, __p1_107, __p2_107) __extension__ ({ \
17174 uint64x2_t __ret_107; \
17175 uint32x2_t __s0_107 = __p0_107; \
17176 uint32x2_t __s1_107 = __p1_107; \
17177 uint32x2_t __rev0_107; __rev0_107 = __builtin_shufflevector(__s0_107, __s0_107, 1, 0); \
17178 uint32x2_t __rev1_107; __rev1_107 = __builtin_shufflevector(__s1_107, __s1_107, 1, 0); \
17179 __ret_107 = __noswap_vmull_u32(__rev0_107, __noswap_splat_lane_u32(__rev1_107, __p2_107)); \
17180 __ret_107 = __builtin_shufflevector(__ret_107, __ret_107, 1, 0); \
17181 __ret_107; \
1715217182})
1715317183#endif
1715417184
1715517185#ifdef __LITTLE_ENDIAN__
17156#define vmull_lane_u16(__p0_104, __p1_104, __p2_104) __extension__ ({ \
17157 uint32x4_t __ret_104; \
17158 uint16x4_t __s0_104 = __p0_104; \
17159 uint16x4_t __s1_104 = __p1_104; \
17160 __ret_104 = vmull_u16(__s0_104, splat_lane_u16(__s1_104, __p2_104)); \
17161 __ret_104; \
17186#define vmull_lane_u16(__p0_108, __p1_108, __p2_108) __extension__ ({ \
17187 uint32x4_t __ret_108; \
17188 uint16x4_t __s0_108 = __p0_108; \
17189 uint16x4_t __s1_108 = __p1_108; \
17190 __ret_108 = vmull_u16(__s0_108, splat_lane_u16(__s1_108, __p2_108)); \
17191 __ret_108; \
1716217192})
1716317193#else
17164#define vmull_lane_u16(__p0_105, __p1_105, __p2_105) __extension__ ({ \
17165 uint32x4_t __ret_105; \
17166 uint16x4_t __s0_105 = __p0_105; \
17167 uint16x4_t __s1_105 = __p1_105; \
17168 uint16x4_t __rev0_105; __rev0_105 = __builtin_shufflevector(__s0_105, __s0_105, 3, 2, 1, 0); \
17169 uint16x4_t __rev1_105; __rev1_105 = __builtin_shufflevector(__s1_105, __s1_105, 3, 2, 1, 0); \
17170 __ret_105 = __noswap_vmull_u16(__rev0_105, __noswap_splat_lane_u16(__rev1_105, __p2_105)); \
17171 __ret_105 = __builtin_shufflevector(__ret_105, __ret_105, 3, 2, 1, 0); \
17172 __ret_105; \
17194#define vmull_lane_u16(__p0_109, __p1_109, __p2_109) __extension__ ({ \
17195 uint32x4_t __ret_109; \
17196 uint16x4_t __s0_109 = __p0_109; \
17197 uint16x4_t __s1_109 = __p1_109; \
17198 uint16x4_t __rev0_109; __rev0_109 = __builtin_shufflevector(__s0_109, __s0_109, 3, 2, 1, 0); \
17199 uint16x4_t __rev1_109; __rev1_109 = __builtin_shufflevector(__s1_109, __s1_109, 3, 2, 1, 0); \
17200 __ret_109 = __noswap_vmull_u16(__rev0_109, __noswap_splat_lane_u16(__rev1_109, __p2_109)); \
17201 __ret_109 = __builtin_shufflevector(__ret_109, __ret_109, 3, 2, 1, 0); \
17202 __ret_109; \
1717317203})
1717417204#endif
1717517205
1717617206#ifdef __LITTLE_ENDIAN__
17177#define vmull_lane_s32(__p0_106, __p1_106, __p2_106) __extension__ ({ \
17178 int64x2_t __ret_106; \
17179 int32x2_t __s0_106 = __p0_106; \
17180 int32x2_t __s1_106 = __p1_106; \
17181 __ret_106 = vmull_s32(__s0_106, splat_lane_s32(__s1_106, __p2_106)); \
17182 __ret_106; \
17207#define vmull_lane_s32(__p0_110, __p1_110, __p2_110) __extension__ ({ \
17208 int64x2_t __ret_110; \
17209 int32x2_t __s0_110 = __p0_110; \
17210 int32x2_t __s1_110 = __p1_110; \
17211 __ret_110 = vmull_s32(__s0_110, splat_lane_s32(__s1_110, __p2_110)); \
17212 __ret_110; \
1718317213})
1718417214#else
17185#define vmull_lane_s32(__p0_107, __p1_107, __p2_107) __extension__ ({ \
17186 int64x2_t __ret_107; \
17187 int32x2_t __s0_107 = __p0_107; \
17188 int32x2_t __s1_107 = __p1_107; \
17189 int32x2_t __rev0_107; __rev0_107 = __builtin_shufflevector(__s0_107, __s0_107, 1, 0); \
17190 int32x2_t __rev1_107; __rev1_107 = __builtin_shufflevector(__s1_107, __s1_107, 1, 0); \
17191 __ret_107 = __noswap_vmull_s32(__rev0_107, __noswap_splat_lane_s32(__rev1_107, __p2_107)); \
17192 __ret_107 = __builtin_shufflevector(__ret_107, __ret_107, 1, 0); \
17193 __ret_107; \
17215#define vmull_lane_s32(__p0_111, __p1_111, __p2_111) __extension__ ({ \
17216 int64x2_t __ret_111; \
17217 int32x2_t __s0_111 = __p0_111; \
17218 int32x2_t __s1_111 = __p1_111; \
17219 int32x2_t __rev0_111; __rev0_111 = __builtin_shufflevector(__s0_111, __s0_111, 1, 0); \
17220 int32x2_t __rev1_111; __rev1_111 = __builtin_shufflevector(__s1_111, __s1_111, 1, 0); \
17221 __ret_111 = __noswap_vmull_s32(__rev0_111, __noswap_splat_lane_s32(__rev1_111, __p2_111)); \
17222 __ret_111 = __builtin_shufflevector(__ret_111, __ret_111, 1, 0); \
17223 __ret_111; \
1719417224})
1719517225#endif
1719617226
1719717227#ifdef __LITTLE_ENDIAN__
17198#define vmull_lane_s16(__p0_108, __p1_108, __p2_108) __extension__ ({ \
17199 int32x4_t __ret_108; \
17200 int16x4_t __s0_108 = __p0_108; \
17201 int16x4_t __s1_108 = __p1_108; \
17202 __ret_108 = vmull_s16(__s0_108, splat_lane_s16(__s1_108, __p2_108)); \
17203 __ret_108; \
17228#define vmull_lane_s16(__p0_112, __p1_112, __p2_112) __extension__ ({ \
17229 int32x4_t __ret_112; \
17230 int16x4_t __s0_112 = __p0_112; \
17231 int16x4_t __s1_112 = __p1_112; \
17232 __ret_112 = vmull_s16(__s0_112, splat_lane_s16(__s1_112, __p2_112)); \
17233 __ret_112; \
1720417234})
1720517235#else
17206#define vmull_lane_s16(__p0_109, __p1_109, __p2_109) __extension__ ({ \
17207 int32x4_t __ret_109; \
17208 int16x4_t __s0_109 = __p0_109; \
17209 int16x4_t __s1_109 = __p1_109; \
17210 int16x4_t __rev0_109; __rev0_109 = __builtin_shufflevector(__s0_109, __s0_109, 3, 2, 1, 0); \
17211 int16x4_t __rev1_109; __rev1_109 = __builtin_shufflevector(__s1_109, __s1_109, 3, 2, 1, 0); \
17212 __ret_109 = __noswap_vmull_s16(__rev0_109, __noswap_splat_lane_s16(__rev1_109, __p2_109)); \
17213 __ret_109 = __builtin_shufflevector(__ret_109, __ret_109, 3, 2, 1, 0); \
17214 __ret_109; \
17236#define vmull_lane_s16(__p0_113, __p1_113, __p2_113) __extension__ ({ \
17237 int32x4_t __ret_113; \
17238 int16x4_t __s0_113 = __p0_113; \
17239 int16x4_t __s1_113 = __p1_113; \
17240 int16x4_t __rev0_113; __rev0_113 = __builtin_shufflevector(__s0_113, __s0_113, 3, 2, 1, 0); \
17241 int16x4_t __rev1_113; __rev1_113 = __builtin_shufflevector(__s1_113, __s1_113, 3, 2, 1, 0); \
17242 __ret_113 = __noswap_vmull_s16(__rev0_113, __noswap_splat_lane_s16(__rev1_113, __p2_113)); \
17243 __ret_113 = __builtin_shufflevector(__ret_113, __ret_113, 3, 2, 1, 0); \
17244 __ret_113; \
1721517245})
1721617246#endif
1721717247
......@@ -19285,50 +19315,50 @@ __ai int32x4_t __noswap_vqdmlal_s16(int32x4_t __p0, int16x4_t __p1, int16x4_t __
1928519315#endif
1928619316
1928719317#ifdef __LITTLE_ENDIAN__
19288#define vqdmlal_lane_s32(__p0_110, __p1_110, __p2_110, __p3_110) __extension__ ({ \
19289 int64x2_t __ret_110; \
19290 int64x2_t __s0_110 = __p0_110; \
19291 int32x2_t __s1_110 = __p1_110; \
19292 int32x2_t __s2_110 = __p2_110; \
19293 __ret_110 = vqdmlal_s32(__s0_110, __s1_110, splat_lane_s32(__s2_110, __p3_110)); \
19294 __ret_110; \
19318#define vqdmlal_lane_s32(__p0_114, __p1_114, __p2_114, __p3_114) __extension__ ({ \
19319 int64x2_t __ret_114; \
19320 int64x2_t __s0_114 = __p0_114; \
19321 int32x2_t __s1_114 = __p1_114; \
19322 int32x2_t __s2_114 = __p2_114; \
19323 __ret_114 = vqdmlal_s32(__s0_114, __s1_114, splat_lane_s32(__s2_114, __p3_114)); \
19324 __ret_114; \
1929519325})
1929619326#else
19297#define vqdmlal_lane_s32(__p0_111, __p1_111, __p2_111, __p3_111) __extension__ ({ \
19298 int64x2_t __ret_111; \
19299 int64x2_t __s0_111 = __p0_111; \
19300 int32x2_t __s1_111 = __p1_111; \
19301 int32x2_t __s2_111 = __p2_111; \
19302 int64x2_t __rev0_111; __rev0_111 = __builtin_shufflevector(__s0_111, __s0_111, 1, 0); \
19303 int32x2_t __rev1_111; __rev1_111 = __builtin_shufflevector(__s1_111, __s1_111, 1, 0); \
19304 int32x2_t __rev2_111; __rev2_111 = __builtin_shufflevector(__s2_111, __s2_111, 1, 0); \
19305 __ret_111 = __noswap_vqdmlal_s32(__rev0_111, __rev1_111, __noswap_splat_lane_s32(__rev2_111, __p3_111)); \
19306 __ret_111 = __builtin_shufflevector(__ret_111, __ret_111, 1, 0); \
19307 __ret_111; \
19327#define vqdmlal_lane_s32(__p0_115, __p1_115, __p2_115, __p3_115) __extension__ ({ \
19328 int64x2_t __ret_115; \
19329 int64x2_t __s0_115 = __p0_115; \
19330 int32x2_t __s1_115 = __p1_115; \
19331 int32x2_t __s2_115 = __p2_115; \
19332 int64x2_t __rev0_115; __rev0_115 = __builtin_shufflevector(__s0_115, __s0_115, 1, 0); \
19333 int32x2_t __rev1_115; __rev1_115 = __builtin_shufflevector(__s1_115, __s1_115, 1, 0); \
19334 int32x2_t __rev2_115; __rev2_115 = __builtin_shufflevector(__s2_115, __s2_115, 1, 0); \
19335 __ret_115 = __noswap_vqdmlal_s32(__rev0_115, __rev1_115, __noswap_splat_lane_s32(__rev2_115, __p3_115)); \
19336 __ret_115 = __builtin_shufflevector(__ret_115, __ret_115, 1, 0); \
19337 __ret_115; \
1930819338})
1930919339#endif
1931019340
1931119341#ifdef __LITTLE_ENDIAN__
19312#define vqdmlal_lane_s16(__p0_112, __p1_112, __p2_112, __p3_112) __extension__ ({ \
19313 int32x4_t __ret_112; \
19314 int32x4_t __s0_112 = __p0_112; \
19315 int16x4_t __s1_112 = __p1_112; \
19316 int16x4_t __s2_112 = __p2_112; \
19317 __ret_112 = vqdmlal_s16(__s0_112, __s1_112, splat_lane_s16(__s2_112, __p3_112)); \
19318 __ret_112; \
19342#define vqdmlal_lane_s16(__p0_116, __p1_116, __p2_116, __p3_116) __extension__ ({ \
19343 int32x4_t __ret_116; \
19344 int32x4_t __s0_116 = __p0_116; \
19345 int16x4_t __s1_116 = __p1_116; \
19346 int16x4_t __s2_116 = __p2_116; \
19347 __ret_116 = vqdmlal_s16(__s0_116, __s1_116, splat_lane_s16(__s2_116, __p3_116)); \
19348 __ret_116; \
1931919349})
1932019350#else
19321#define vqdmlal_lane_s16(__p0_113, __p1_113, __p2_113, __p3_113) __extension__ ({ \
19322 int32x4_t __ret_113; \
19323 int32x4_t __s0_113 = __p0_113; \
19324 int16x4_t __s1_113 = __p1_113; \
19325 int16x4_t __s2_113 = __p2_113; \
19326 int32x4_t __rev0_113; __rev0_113 = __builtin_shufflevector(__s0_113, __s0_113, 3, 2, 1, 0); \
19327 int16x4_t __rev1_113; __rev1_113 = __builtin_shufflevector(__s1_113, __s1_113, 3, 2, 1, 0); \
19328 int16x4_t __rev2_113; __rev2_113 = __builtin_shufflevector(__s2_113, __s2_113, 3, 2, 1, 0); \
19329 __ret_113 = __noswap_vqdmlal_s16(__rev0_113, __rev1_113, __noswap_splat_lane_s16(__rev2_113, __p3_113)); \
19330 __ret_113 = __builtin_shufflevector(__ret_113, __ret_113, 3, 2, 1, 0); \
19331 __ret_113; \
19351#define vqdmlal_lane_s16(__p0_117, __p1_117, __p2_117, __p3_117) __extension__ ({ \
19352 int32x4_t __ret_117; \
19353 int32x4_t __s0_117 = __p0_117; \
19354 int16x4_t __s1_117 = __p1_117; \
19355 int16x4_t __s2_117 = __p2_117; \
19356 int32x4_t __rev0_117; __rev0_117 = __builtin_shufflevector(__s0_117, __s0_117, 3, 2, 1, 0); \
19357 int16x4_t __rev1_117; __rev1_117 = __builtin_shufflevector(__s1_117, __s1_117, 3, 2, 1, 0); \
19358 int16x4_t __rev2_117; __rev2_117 = __builtin_shufflevector(__s2_117, __s2_117, 3, 2, 1, 0); \
19359 __ret_117 = __noswap_vqdmlal_s16(__rev0_117, __rev1_117, __noswap_splat_lane_s16(__rev2_117, __p3_117)); \
19360 __ret_117 = __builtin_shufflevector(__ret_117, __ret_117, 3, 2, 1, 0); \
19361 __ret_117; \
1933219362})
1933319363#endif
1933419364
......@@ -19423,50 +19453,50 @@ __ai int32x4_t __noswap_vqdmlsl_s16(int32x4_t __p0, int16x4_t __p1, int16x4_t __
1942319453#endif
1942419454
1942519455#ifdef __LITTLE_ENDIAN__
19426#define vqdmlsl_lane_s32(__p0_114, __p1_114, __p2_114, __p3_114) __extension__ ({ \
19427 int64x2_t __ret_114; \
19428 int64x2_t __s0_114 = __p0_114; \
19429 int32x2_t __s1_114 = __p1_114; \
19430 int32x2_t __s2_114 = __p2_114; \
19431 __ret_114 = vqdmlsl_s32(__s0_114, __s1_114, splat_lane_s32(__s2_114, __p3_114)); \
19432 __ret_114; \
19456#define vqdmlsl_lane_s32(__p0_118, __p1_118, __p2_118, __p3_118) __extension__ ({ \
19457 int64x2_t __ret_118; \
19458 int64x2_t __s0_118 = __p0_118; \
19459 int32x2_t __s1_118 = __p1_118; \
19460 int32x2_t __s2_118 = __p2_118; \
19461 __ret_118 = vqdmlsl_s32(__s0_118, __s1_118, splat_lane_s32(__s2_118, __p3_118)); \
19462 __ret_118; \
1943319463})
1943419464#else
19435#define vqdmlsl_lane_s32(__p0_115, __p1_115, __p2_115, __p3_115) __extension__ ({ \
19436 int64x2_t __ret_115; \
19437 int64x2_t __s0_115 = __p0_115; \
19438 int32x2_t __s1_115 = __p1_115; \
19439 int32x2_t __s2_115 = __p2_115; \
19440 int64x2_t __rev0_115; __rev0_115 = __builtin_shufflevector(__s0_115, __s0_115, 1, 0); \
19441 int32x2_t __rev1_115; __rev1_115 = __builtin_shufflevector(__s1_115, __s1_115, 1, 0); \
19442 int32x2_t __rev2_115; __rev2_115 = __builtin_shufflevector(__s2_115, __s2_115, 1, 0); \
19443 __ret_115 = __noswap_vqdmlsl_s32(__rev0_115, __rev1_115, __noswap_splat_lane_s32(__rev2_115, __p3_115)); \
19444 __ret_115 = __builtin_shufflevector(__ret_115, __ret_115, 1, 0); \
19445 __ret_115; \
19465#define vqdmlsl_lane_s32(__p0_119, __p1_119, __p2_119, __p3_119) __extension__ ({ \
19466 int64x2_t __ret_119; \
19467 int64x2_t __s0_119 = __p0_119; \
19468 int32x2_t __s1_119 = __p1_119; \
19469 int32x2_t __s2_119 = __p2_119; \
19470 int64x2_t __rev0_119; __rev0_119 = __builtin_shufflevector(__s0_119, __s0_119, 1, 0); \
19471 int32x2_t __rev1_119; __rev1_119 = __builtin_shufflevector(__s1_119, __s1_119, 1, 0); \
19472 int32x2_t __rev2_119; __rev2_119 = __builtin_shufflevector(__s2_119, __s2_119, 1, 0); \
19473 __ret_119 = __noswap_vqdmlsl_s32(__rev0_119, __rev1_119, __noswap_splat_lane_s32(__rev2_119, __p3_119)); \
19474 __ret_119 = __builtin_shufflevector(__ret_119, __ret_119, 1, 0); \
19475 __ret_119; \
1944619476})
1944719477#endif
1944819478
1944919479#ifdef __LITTLE_ENDIAN__
19450#define vqdmlsl_lane_s16(__p0_116, __p1_116, __p2_116, __p3_116) __extension__ ({ \
19451 int32x4_t __ret_116; \
19452 int32x4_t __s0_116 = __p0_116; \
19453 int16x4_t __s1_116 = __p1_116; \
19454 int16x4_t __s2_116 = __p2_116; \
19455 __ret_116 = vqdmlsl_s16(__s0_116, __s1_116, splat_lane_s16(__s2_116, __p3_116)); \
19456 __ret_116; \
19480#define vqdmlsl_lane_s16(__p0_120, __p1_120, __p2_120, __p3_120) __extension__ ({ \
19481 int32x4_t __ret_120; \
19482 int32x4_t __s0_120 = __p0_120; \
19483 int16x4_t __s1_120 = __p1_120; \
19484 int16x4_t __s2_120 = __p2_120; \
19485 __ret_120 = vqdmlsl_s16(__s0_120, __s1_120, splat_lane_s16(__s2_120, __p3_120)); \
19486 __ret_120; \
1945719487})
1945819488#else
19459#define vqdmlsl_lane_s16(__p0_117, __p1_117, __p2_117, __p3_117) __extension__ ({ \
19460 int32x4_t __ret_117; \
19461 int32x4_t __s0_117 = __p0_117; \
19462 int16x4_t __s1_117 = __p1_117; \
19463 int16x4_t __s2_117 = __p2_117; \
19464 int32x4_t __rev0_117; __rev0_117 = __builtin_shufflevector(__s0_117, __s0_117, 3, 2, 1, 0); \
19465 int16x4_t __rev1_117; __rev1_117 = __builtin_shufflevector(__s1_117, __s1_117, 3, 2, 1, 0); \
19466 int16x4_t __rev2_117; __rev2_117 = __builtin_shufflevector(__s2_117, __s2_117, 3, 2, 1, 0); \
19467 __ret_117 = __noswap_vqdmlsl_s16(__rev0_117, __rev1_117, __noswap_splat_lane_s16(__rev2_117, __p3_117)); \
19468 __ret_117 = __builtin_shufflevector(__ret_117, __ret_117, 3, 2, 1, 0); \
19469 __ret_117; \
19489#define vqdmlsl_lane_s16(__p0_121, __p1_121, __p2_121, __p3_121) __extension__ ({ \
19490 int32x4_t __ret_121; \
19491 int32x4_t __s0_121 = __p0_121; \
19492 int16x4_t __s1_121 = __p1_121; \
19493 int16x4_t __s2_121 = __p2_121; \
19494 int32x4_t __rev0_121; __rev0_121 = __builtin_shufflevector(__s0_121, __s0_121, 3, 2, 1, 0); \
19495 int16x4_t __rev1_121; __rev1_121 = __builtin_shufflevector(__s1_121, __s1_121, 3, 2, 1, 0); \
19496 int16x4_t __rev2_121; __rev2_121 = __builtin_shufflevector(__s2_121, __s2_121, 3, 2, 1, 0); \
19497 __ret_121 = __noswap_vqdmlsl_s16(__rev0_121, __rev1_121, __noswap_splat_lane_s16(__rev2_121, __p3_121)); \
19498 __ret_121 = __builtin_shufflevector(__ret_121, __ret_121, 3, 2, 1, 0); \
19499 __ret_121; \
1947019500})
1947119501#endif
1947219502
......@@ -19711,44 +19741,44 @@ __ai int32x4_t __noswap_vqdmull_s16(int16x4_t __p0, int16x4_t __p1) {
1971119741#endif
1971219742
1971319743#ifdef __LITTLE_ENDIAN__
19714#define vqdmull_lane_s32(__p0_118, __p1_118, __p2_118) __extension__ ({ \
19715 int64x2_t __ret_118; \
19716 int32x2_t __s0_118 = __p0_118; \
19717 int32x2_t __s1_118 = __p1_118; \
19718 __ret_118 = vqdmull_s32(__s0_118, splat_lane_s32(__s1_118, __p2_118)); \
19719 __ret_118; \
19744#define vqdmull_lane_s32(__p0_122, __p1_122, __p2_122) __extension__ ({ \
19745 int64x2_t __ret_122; \
19746 int32x2_t __s0_122 = __p0_122; \
19747 int32x2_t __s1_122 = __p1_122; \
19748 __ret_122 = vqdmull_s32(__s0_122, splat_lane_s32(__s1_122, __p2_122)); \
19749 __ret_122; \
1972019750})
1972119751#else
19722#define vqdmull_lane_s32(__p0_119, __p1_119, __p2_119) __extension__ ({ \
19723 int64x2_t __ret_119; \
19724 int32x2_t __s0_119 = __p0_119; \
19725 int32x2_t __s1_119 = __p1_119; \
19726 int32x2_t __rev0_119; __rev0_119 = __builtin_shufflevector(__s0_119, __s0_119, 1, 0); \
19727 int32x2_t __rev1_119; __rev1_119 = __builtin_shufflevector(__s1_119, __s1_119, 1, 0); \
19728 __ret_119 = __noswap_vqdmull_s32(__rev0_119, __noswap_splat_lane_s32(__rev1_119, __p2_119)); \
19729 __ret_119 = __builtin_shufflevector(__ret_119, __ret_119, 1, 0); \
19730 __ret_119; \
19752#define vqdmull_lane_s32(__p0_123, __p1_123, __p2_123) __extension__ ({ \
19753 int64x2_t __ret_123; \
19754 int32x2_t __s0_123 = __p0_123; \
19755 int32x2_t __s1_123 = __p1_123; \
19756 int32x2_t __rev0_123; __rev0_123 = __builtin_shufflevector(__s0_123, __s0_123, 1, 0); \
19757 int32x2_t __rev1_123; __rev1_123 = __builtin_shufflevector(__s1_123, __s1_123, 1, 0); \
19758 __ret_123 = __noswap_vqdmull_s32(__rev0_123, __noswap_splat_lane_s32(__rev1_123, __p2_123)); \
19759 __ret_123 = __builtin_shufflevector(__ret_123, __ret_123, 1, 0); \
19760 __ret_123; \
1973119761})
1973219762#endif
1973319763
1973419764#ifdef __LITTLE_ENDIAN__
19735#define vqdmull_lane_s16(__p0_120, __p1_120, __p2_120) __extension__ ({ \
19736 int32x4_t __ret_120; \
19737 int16x4_t __s0_120 = __p0_120; \
19738 int16x4_t __s1_120 = __p1_120; \
19739 __ret_120 = vqdmull_s16(__s0_120, splat_lane_s16(__s1_120, __p2_120)); \
19740 __ret_120; \
19765#define vqdmull_lane_s16(__p0_124, __p1_124, __p2_124) __extension__ ({ \
19766 int32x4_t __ret_124; \
19767 int16x4_t __s0_124 = __p0_124; \
19768 int16x4_t __s1_124 = __p1_124; \
19769 __ret_124 = vqdmull_s16(__s0_124, splat_lane_s16(__s1_124, __p2_124)); \
19770 __ret_124; \
1974119771})
1974219772#else
19743#define vqdmull_lane_s16(__p0_121, __p1_121, __p2_121) __extension__ ({ \
19744 int32x4_t __ret_121; \
19745 int16x4_t __s0_121 = __p0_121; \
19746 int16x4_t __s1_121 = __p1_121; \
19747 int16x4_t __rev0_121; __rev0_121 = __builtin_shufflevector(__s0_121, __s0_121, 3, 2, 1, 0); \
19748 int16x4_t __rev1_121; __rev1_121 = __builtin_shufflevector(__s1_121, __s1_121, 3, 2, 1, 0); \
19749 __ret_121 = __noswap_vqdmull_s16(__rev0_121, __noswap_splat_lane_s16(__rev1_121, __p2_121)); \
19750 __ret_121 = __builtin_shufflevector(__ret_121, __ret_121, 3, 2, 1, 0); \
19751 __ret_121; \
19773#define vqdmull_lane_s16(__p0_125, __p1_125, __p2_125) __extension__ ({ \
19774 int32x4_t __ret_125; \
19775 int16x4_t __s0_125 = __p0_125; \
19776 int16x4_t __s1_125 = __p1_125; \
19777 int16x4_t __rev0_125; __rev0_125 = __builtin_shufflevector(__s0_125, __s0_125, 3, 2, 1, 0); \
19778 int16x4_t __rev1_125; __rev1_125 = __builtin_shufflevector(__s1_125, __s1_125, 3, 2, 1, 0); \
19779 __ret_125 = __noswap_vqdmull_s16(__rev0_125, __noswap_splat_lane_s16(__rev1_125, __p2_125)); \
19780 __ret_125 = __builtin_shufflevector(__ret_125, __ret_125, 3, 2, 1, 0); \
19781 __ret_125; \
1975219782})
1975319783#endif
1975419784
......@@ -32235,4366 +32265,5707 @@ __ai int16x4x2_t vzip_s16(int16x4_t __p0, int16x4_t __p1) {
3223532265}
3223632266#endif
3223732267
32238#if !defined(__aarch64__)
3223932268#ifdef __LITTLE_ENDIAN__
32240#define vdupq_lane_f16(__p0_122, __p1_122) __extension__ ({ \
32241 float16x8_t __ret_122; \
32242 float16x4_t __s0_122 = __p0_122; \
32243 __ret_122 = splatq_lane_f16(__s0_122, __p1_122); \
32244 __ret_122; \
32269#define splatq_lane_bf16(__p0, __p1) __extension__ ({ \
32270 bfloat16x8_t __ret; \
32271 bfloat16x4_t __s0 = __p0; \
32272 __ret = (bfloat16x8_t) __builtin_neon_splatq_lane_bf16((int8x8_t)__s0, __p1, 11); \
32273 __ret; \
3224532274})
3224632275#else
32247#define vdupq_lane_f16(__p0_123, __p1_123) __extension__ ({ \
32248 float16x8_t __ret_123; \
32249 float16x4_t __s0_123 = __p0_123; \
32250 float16x4_t __rev0_123; __rev0_123 = __builtin_shufflevector(__s0_123, __s0_123, 3, 2, 1, 0); \
32251 __ret_123 = __noswap_splatq_lane_f16(__rev0_123, __p1_123); \
32252 __ret_123 = __builtin_shufflevector(__ret_123, __ret_123, 7, 6, 5, 4, 3, 2, 1, 0); \
32253 __ret_123; \
32276#define splatq_lane_bf16(__p0, __p1) __extension__ ({ \
32277 bfloat16x8_t __ret; \
32278 bfloat16x4_t __s0 = __p0; \
32279 bfloat16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
32280 __ret = (bfloat16x8_t) __builtin_neon_splatq_lane_bf16((int8x8_t)__rev0, __p1, 11); \
32281 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
32282 __ret; \
32283})
32284#define __noswap_splatq_lane_bf16(__p0, __p1) __extension__ ({ \
32285 bfloat16x8_t __ret; \
32286 bfloat16x4_t __s0 = __p0; \
32287 __ret = (bfloat16x8_t) __builtin_neon_splatq_lane_bf16((int8x8_t)__s0, __p1, 11); \
32288 __ret; \
3225432289})
3225532290#endif
3225632291
3225732292#ifdef __LITTLE_ENDIAN__
32258#define vdup_lane_f16(__p0_124, __p1_124) __extension__ ({ \
32259 float16x4_t __ret_124; \
32260 float16x4_t __s0_124 = __p0_124; \
32261 __ret_124 = splat_lane_f16(__s0_124, __p1_124); \
32262 __ret_124; \
32293#define splat_lane_bf16(__p0, __p1) __extension__ ({ \
32294 bfloat16x4_t __ret; \
32295 bfloat16x4_t __s0 = __p0; \
32296 __ret = (bfloat16x4_t) __builtin_neon_splat_lane_bf16((int8x8_t)__s0, __p1, 11); \
32297 __ret; \
3226332298})
3226432299#else
32265#define vdup_lane_f16(__p0_125, __p1_125) __extension__ ({ \
32266 float16x4_t __ret_125; \
32267 float16x4_t __s0_125 = __p0_125; \
32268 float16x4_t __rev0_125; __rev0_125 = __builtin_shufflevector(__s0_125, __s0_125, 3, 2, 1, 0); \
32269 __ret_125 = __noswap_splat_lane_f16(__rev0_125, __p1_125); \
32270 __ret_125 = __builtin_shufflevector(__ret_125, __ret_125, 3, 2, 1, 0); \
32271 __ret_125; \
32300#define splat_lane_bf16(__p0, __p1) __extension__ ({ \
32301 bfloat16x4_t __ret; \
32302 bfloat16x4_t __s0 = __p0; \
32303 bfloat16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
32304 __ret = (bfloat16x4_t) __builtin_neon_splat_lane_bf16((int8x8_t)__rev0, __p1, 11); \
32305 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
32306 __ret; \
32307})
32308#define __noswap_splat_lane_bf16(__p0, __p1) __extension__ ({ \
32309 bfloat16x4_t __ret; \
32310 bfloat16x4_t __s0 = __p0; \
32311 __ret = (bfloat16x4_t) __builtin_neon_splat_lane_bf16((int8x8_t)__s0, __p1, 11); \
32312 __ret; \
3227232313})
3227332314#endif
3227432315
3227532316#ifdef __LITTLE_ENDIAN__
32276#define vdupq_n_f16(__p0) __extension__ ({ \
32277 float16x8_t __ret; \
32278 float16_t __s0 = __p0; \
32279 __ret = (float16x8_t) {__s0, __s0, __s0, __s0, __s0, __s0, __s0, __s0}; \
32317#define splatq_laneq_bf16(__p0, __p1) __extension__ ({ \
32318 bfloat16x8_t __ret; \
32319 bfloat16x8_t __s0 = __p0; \
32320 __ret = (bfloat16x8_t) __builtin_neon_splatq_laneq_bf16((int8x16_t)__s0, __p1, 43); \
3228032321 __ret; \
3228132322})
3228232323#else
32283#define vdupq_n_f16(__p0) __extension__ ({ \
32284 float16x8_t __ret; \
32285 float16_t __s0 = __p0; \
32286 __ret = (float16x8_t) {__s0, __s0, __s0, __s0, __s0, __s0, __s0, __s0}; \
32324#define splatq_laneq_bf16(__p0, __p1) __extension__ ({ \
32325 bfloat16x8_t __ret; \
32326 bfloat16x8_t __s0 = __p0; \
32327 bfloat16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
32328 __ret = (bfloat16x8_t) __builtin_neon_splatq_laneq_bf16((int8x16_t)__rev0, __p1, 43); \
3228732329 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
3228832330 __ret; \
3228932331})
32332#define __noswap_splatq_laneq_bf16(__p0, __p1) __extension__ ({ \
32333 bfloat16x8_t __ret; \
32334 bfloat16x8_t __s0 = __p0; \
32335 __ret = (bfloat16x8_t) __builtin_neon_splatq_laneq_bf16((int8x16_t)__s0, __p1, 43); \
32336 __ret; \
32337})
3229032338#endif
3229132339
3229232340#ifdef __LITTLE_ENDIAN__
32293#define vdup_n_f16(__p0) __extension__ ({ \
32294 float16x4_t __ret; \
32295 float16_t __s0 = __p0; \
32296 __ret = (float16x4_t) {__s0, __s0, __s0, __s0}; \
32341#define splat_laneq_bf16(__p0, __p1) __extension__ ({ \
32342 bfloat16x4_t __ret; \
32343 bfloat16x8_t __s0 = __p0; \
32344 __ret = (bfloat16x4_t) __builtin_neon_splat_laneq_bf16((int8x16_t)__s0, __p1, 43); \
3229732345 __ret; \
3229832346})
3229932347#else
32300#define vdup_n_f16(__p0) __extension__ ({ \
32301 float16x4_t __ret; \
32302 float16_t __s0 = __p0; \
32303 __ret = (float16x4_t) {__s0, __s0, __s0, __s0}; \
32348#define splat_laneq_bf16(__p0, __p1) __extension__ ({ \
32349 bfloat16x4_t __ret; \
32350 bfloat16x8_t __s0 = __p0; \
32351 bfloat16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
32352 __ret = (bfloat16x4_t) __builtin_neon_splat_laneq_bf16((int8x16_t)__rev0, __p1, 43); \
3230432353 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
3230532354 __ret; \
3230632355})
32356#define __noswap_splat_laneq_bf16(__p0, __p1) __extension__ ({ \
32357 bfloat16x4_t __ret; \
32358 bfloat16x8_t __s0 = __p0; \
32359 __ret = (bfloat16x4_t) __builtin_neon_splat_laneq_bf16((int8x16_t)__s0, __p1, 43); \
32360 __ret; \
32361})
3230732362#endif
3230832363
3230932364#ifdef __LITTLE_ENDIAN__
32310#define vmovq_n_f16(__p0) __extension__ ({ \
32311 float16x8_t __ret; \
32312 float16_t __s0 = __p0; \
32313 __ret = (float16x8_t) {__s0, __s0, __s0, __s0, __s0, __s0, __s0, __s0}; \
32314 __ret; \
32315})
32365__ai __attribute__((target("bf16"))) float32x4_t vbfdotq_f32(float32x4_t __p0, bfloat16x8_t __p1, bfloat16x8_t __p2) {
32366 float32x4_t __ret;
32367 __ret = (float32x4_t) __builtin_neon_vbfdotq_f32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
32368 return __ret;
32369}
3231632370#else
32317#define vmovq_n_f16(__p0) __extension__ ({ \
32318 float16x8_t __ret; \
32319 float16_t __s0 = __p0; \
32320 __ret = (float16x8_t) {__s0, __s0, __s0, __s0, __s0, __s0, __s0, __s0}; \
32321 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
32322 __ret; \
32323})
32371__ai __attribute__((target("bf16"))) float32x4_t vbfdotq_f32(float32x4_t __p0, bfloat16x8_t __p1, bfloat16x8_t __p2) {
32372 float32x4_t __ret;
32373 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
32374 bfloat16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
32375 bfloat16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
32376 __ret = (float32x4_t) __builtin_neon_vbfdotq_f32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 41);
32377 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
32378 return __ret;
32379}
32380__ai __attribute__((target("bf16"))) float32x4_t __noswap_vbfdotq_f32(float32x4_t __p0, bfloat16x8_t __p1, bfloat16x8_t __p2) {
32381 float32x4_t __ret;
32382 __ret = (float32x4_t) __builtin_neon_vbfdotq_f32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
32383 return __ret;
32384}
3232432385#endif
3232532386
3232632387#ifdef __LITTLE_ENDIAN__
32327#define vmov_n_f16(__p0) __extension__ ({ \
32328 float16x4_t __ret; \
32329 float16_t __s0 = __p0; \
32330 __ret = (float16x4_t) {__s0, __s0, __s0, __s0}; \
32331 __ret; \
32332})
32388__ai __attribute__((target("bf16"))) float32x2_t vbfdot_f32(float32x2_t __p0, bfloat16x4_t __p1, bfloat16x4_t __p2) {
32389 float32x2_t __ret;
32390 __ret = (float32x2_t) __builtin_neon_vbfdot_f32((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
32391 return __ret;
32392}
3233332393#else
32334#define vmov_n_f16(__p0) __extension__ ({ \
32335 float16x4_t __ret; \
32336 float16_t __s0 = __p0; \
32337 __ret = (float16x4_t) {__s0, __s0, __s0, __s0}; \
32338 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
32339 __ret; \
32340})
32394__ai __attribute__((target("bf16"))) float32x2_t vbfdot_f32(float32x2_t __p0, bfloat16x4_t __p1, bfloat16x4_t __p2) {
32395 float32x2_t __ret;
32396 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
32397 bfloat16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
32398 bfloat16x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
32399 __ret = (float32x2_t) __builtin_neon_vbfdot_f32((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 9);
32400 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
32401 return __ret;
32402}
32403__ai __attribute__((target("bf16"))) float32x2_t __noswap_vbfdot_f32(float32x2_t __p0, bfloat16x4_t __p1, bfloat16x4_t __p2) {
32404 float32x2_t __ret;
32405 __ret = (float32x2_t) __builtin_neon_vbfdot_f32((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
32406 return __ret;
32407}
3234132408#endif
3234232409
3234332410#ifdef __LITTLE_ENDIAN__
32344#define vqdmulhq_lane_s32(__p0_126, __p1_126, __p2_126) __extension__ ({ \
32345 int32x4_t __ret_126; \
32346 int32x4_t __s0_126 = __p0_126; \
32347 int32x2_t __s1_126 = __p1_126; \
32348 __ret_126 = vqdmulhq_s32(__s0_126, splatq_lane_s32(__s1_126, __p2_126)); \
32411#define vbfdotq_lane_f32(__p0_126, __p1_126, __p2_126, __p3_126) __extension__ ({ \
32412 float32x4_t __ret_126; \
32413 float32x4_t __s0_126 = __p0_126; \
32414 bfloat16x8_t __s1_126 = __p1_126; \
32415 bfloat16x4_t __s2_126 = __p2_126; \
32416bfloat16x4_t __reint_126 = __s2_126; \
32417float32x4_t __reint1_126 = splatq_lane_f32(*(float32x2_t *) &__reint_126, __p3_126); \
32418 __ret_126 = vbfdotq_f32(__s0_126, __s1_126, *(bfloat16x8_t *) &__reint1_126); \
3234932419 __ret_126; \
3235032420})
3235132421#else
32352#define vqdmulhq_lane_s32(__p0_127, __p1_127, __p2_127) __extension__ ({ \
32353 int32x4_t __ret_127; \
32354 int32x4_t __s0_127 = __p0_127; \
32355 int32x2_t __s1_127 = __p1_127; \
32356 int32x4_t __rev0_127; __rev0_127 = __builtin_shufflevector(__s0_127, __s0_127, 3, 2, 1, 0); \
32357 int32x2_t __rev1_127; __rev1_127 = __builtin_shufflevector(__s1_127, __s1_127, 1, 0); \
32358 __ret_127 = __noswap_vqdmulhq_s32(__rev0_127, __noswap_splatq_lane_s32(__rev1_127, __p2_127)); \
32422#define vbfdotq_lane_f32(__p0_127, __p1_127, __p2_127, __p3_127) __extension__ ({ \
32423 float32x4_t __ret_127; \
32424 float32x4_t __s0_127 = __p0_127; \
32425 bfloat16x8_t __s1_127 = __p1_127; \
32426 bfloat16x4_t __s2_127 = __p2_127; \
32427 float32x4_t __rev0_127; __rev0_127 = __builtin_shufflevector(__s0_127, __s0_127, 3, 2, 1, 0); \
32428 bfloat16x8_t __rev1_127; __rev1_127 = __builtin_shufflevector(__s1_127, __s1_127, 7, 6, 5, 4, 3, 2, 1, 0); \
32429 bfloat16x4_t __rev2_127; __rev2_127 = __builtin_shufflevector(__s2_127, __s2_127, 3, 2, 1, 0); \
32430bfloat16x4_t __reint_127 = __rev2_127; \
32431float32x4_t __reint1_127 = __noswap_splatq_lane_f32(*(float32x2_t *) &__reint_127, __p3_127); \
32432 __ret_127 = __noswap_vbfdotq_f32(__rev0_127, __rev1_127, *(bfloat16x8_t *) &__reint1_127); \
3235932433 __ret_127 = __builtin_shufflevector(__ret_127, __ret_127, 3, 2, 1, 0); \
3236032434 __ret_127; \
3236132435})
3236232436#endif
3236332437
3236432438#ifdef __LITTLE_ENDIAN__
32365#define vqdmulhq_lane_s16(__p0_128, __p1_128, __p2_128) __extension__ ({ \
32366 int16x8_t __ret_128; \
32367 int16x8_t __s0_128 = __p0_128; \
32368 int16x4_t __s1_128 = __p1_128; \
32369 __ret_128 = vqdmulhq_s16(__s0_128, splatq_lane_s16(__s1_128, __p2_128)); \
32439#define vbfdot_lane_f32(__p0_128, __p1_128, __p2_128, __p3_128) __extension__ ({ \
32440 float32x2_t __ret_128; \
32441 float32x2_t __s0_128 = __p0_128; \
32442 bfloat16x4_t __s1_128 = __p1_128; \
32443 bfloat16x4_t __s2_128 = __p2_128; \
32444bfloat16x4_t __reint_128 = __s2_128; \
32445float32x2_t __reint1_128 = splat_lane_f32(*(float32x2_t *) &__reint_128, __p3_128); \
32446 __ret_128 = vbfdot_f32(__s0_128, __s1_128, *(bfloat16x4_t *) &__reint1_128); \
3237032447 __ret_128; \
3237132448})
3237232449#else
32373#define vqdmulhq_lane_s16(__p0_129, __p1_129, __p2_129) __extension__ ({ \
32374 int16x8_t __ret_129; \
32375 int16x8_t __s0_129 = __p0_129; \
32376 int16x4_t __s1_129 = __p1_129; \
32377 int16x8_t __rev0_129; __rev0_129 = __builtin_shufflevector(__s0_129, __s0_129, 7, 6, 5, 4, 3, 2, 1, 0); \
32378 int16x4_t __rev1_129; __rev1_129 = __builtin_shufflevector(__s1_129, __s1_129, 3, 2, 1, 0); \
32379 __ret_129 = __noswap_vqdmulhq_s16(__rev0_129, __noswap_splatq_lane_s16(__rev1_129, __p2_129)); \
32380 __ret_129 = __builtin_shufflevector(__ret_129, __ret_129, 7, 6, 5, 4, 3, 2, 1, 0); \
32450#define vbfdot_lane_f32(__p0_129, __p1_129, __p2_129, __p3_129) __extension__ ({ \
32451 float32x2_t __ret_129; \
32452 float32x2_t __s0_129 = __p0_129; \
32453 bfloat16x4_t __s1_129 = __p1_129; \
32454 bfloat16x4_t __s2_129 = __p2_129; \
32455 float32x2_t __rev0_129; __rev0_129 = __builtin_shufflevector(__s0_129, __s0_129, 1, 0); \
32456 bfloat16x4_t __rev1_129; __rev1_129 = __builtin_shufflevector(__s1_129, __s1_129, 3, 2, 1, 0); \
32457 bfloat16x4_t __rev2_129; __rev2_129 = __builtin_shufflevector(__s2_129, __s2_129, 3, 2, 1, 0); \
32458bfloat16x4_t __reint_129 = __rev2_129; \
32459float32x2_t __reint1_129 = __noswap_splat_lane_f32(*(float32x2_t *) &__reint_129, __p3_129); \
32460 __ret_129 = __noswap_vbfdot_f32(__rev0_129, __rev1_129, *(bfloat16x4_t *) &__reint1_129); \
32461 __ret_129 = __builtin_shufflevector(__ret_129, __ret_129, 1, 0); \
3238132462 __ret_129; \
3238232463})
3238332464#endif
3238432465
3238532466#ifdef __LITTLE_ENDIAN__
32386#define vqdmulh_lane_s32(__p0_130, __p1_130, __p2_130) __extension__ ({ \
32387 int32x2_t __ret_130; \
32388 int32x2_t __s0_130 = __p0_130; \
32389 int32x2_t __s1_130 = __p1_130; \
32390 __ret_130 = vqdmulh_s32(__s0_130, splat_lane_s32(__s1_130, __p2_130)); \
32467#define vbfdotq_laneq_f32(__p0_130, __p1_130, __p2_130, __p3_130) __extension__ ({ \
32468 float32x4_t __ret_130; \
32469 float32x4_t __s0_130 = __p0_130; \
32470 bfloat16x8_t __s1_130 = __p1_130; \
32471 bfloat16x8_t __s2_130 = __p2_130; \
32472bfloat16x8_t __reint_130 = __s2_130; \
32473float32x4_t __reint1_130 = splatq_laneq_f32(*(float32x4_t *) &__reint_130, __p3_130); \
32474 __ret_130 = vbfdotq_f32(__s0_130, __s1_130, *(bfloat16x8_t *) &__reint1_130); \
3239132475 __ret_130; \
3239232476})
3239332477#else
32394#define vqdmulh_lane_s32(__p0_131, __p1_131, __p2_131) __extension__ ({ \
32395 int32x2_t __ret_131; \
32396 int32x2_t __s0_131 = __p0_131; \
32397 int32x2_t __s1_131 = __p1_131; \
32398 int32x2_t __rev0_131; __rev0_131 = __builtin_shufflevector(__s0_131, __s0_131, 1, 0); \
32399 int32x2_t __rev1_131; __rev1_131 = __builtin_shufflevector(__s1_131, __s1_131, 1, 0); \
32400 __ret_131 = __noswap_vqdmulh_s32(__rev0_131, __noswap_splat_lane_s32(__rev1_131, __p2_131)); \
32401 __ret_131 = __builtin_shufflevector(__ret_131, __ret_131, 1, 0); \
32478#define vbfdotq_laneq_f32(__p0_131, __p1_131, __p2_131, __p3_131) __extension__ ({ \
32479 float32x4_t __ret_131; \
32480 float32x4_t __s0_131 = __p0_131; \
32481 bfloat16x8_t __s1_131 = __p1_131; \
32482 bfloat16x8_t __s2_131 = __p2_131; \
32483 float32x4_t __rev0_131; __rev0_131 = __builtin_shufflevector(__s0_131, __s0_131, 3, 2, 1, 0); \
32484 bfloat16x8_t __rev1_131; __rev1_131 = __builtin_shufflevector(__s1_131, __s1_131, 7, 6, 5, 4, 3, 2, 1, 0); \
32485 bfloat16x8_t __rev2_131; __rev2_131 = __builtin_shufflevector(__s2_131, __s2_131, 7, 6, 5, 4, 3, 2, 1, 0); \
32486bfloat16x8_t __reint_131 = __rev2_131; \
32487float32x4_t __reint1_131 = __noswap_splatq_laneq_f32(*(float32x4_t *) &__reint_131, __p3_131); \
32488 __ret_131 = __noswap_vbfdotq_f32(__rev0_131, __rev1_131, *(bfloat16x8_t *) &__reint1_131); \
32489 __ret_131 = __builtin_shufflevector(__ret_131, __ret_131, 3, 2, 1, 0); \
3240232490 __ret_131; \
3240332491})
3240432492#endif
3240532493
3240632494#ifdef __LITTLE_ENDIAN__
32407#define vqdmulh_lane_s16(__p0_132, __p1_132, __p2_132) __extension__ ({ \
32408 int16x4_t __ret_132; \
32409 int16x4_t __s0_132 = __p0_132; \
32410 int16x4_t __s1_132 = __p1_132; \
32411 __ret_132 = vqdmulh_s16(__s0_132, splat_lane_s16(__s1_132, __p2_132)); \
32495#define vbfdot_laneq_f32(__p0_132, __p1_132, __p2_132, __p3_132) __extension__ ({ \
32496 float32x2_t __ret_132; \
32497 float32x2_t __s0_132 = __p0_132; \
32498 bfloat16x4_t __s1_132 = __p1_132; \
32499 bfloat16x8_t __s2_132 = __p2_132; \
32500bfloat16x8_t __reint_132 = __s2_132; \
32501float32x2_t __reint1_132 = splat_laneq_f32(*(float32x4_t *) &__reint_132, __p3_132); \
32502 __ret_132 = vbfdot_f32(__s0_132, __s1_132, *(bfloat16x4_t *) &__reint1_132); \
3241232503 __ret_132; \
3241332504})
3241432505#else
32415#define vqdmulh_lane_s16(__p0_133, __p1_133, __p2_133) __extension__ ({ \
32416 int16x4_t __ret_133; \
32417 int16x4_t __s0_133 = __p0_133; \
32418 int16x4_t __s1_133 = __p1_133; \
32419 int16x4_t __rev0_133; __rev0_133 = __builtin_shufflevector(__s0_133, __s0_133, 3, 2, 1, 0); \
32420 int16x4_t __rev1_133; __rev1_133 = __builtin_shufflevector(__s1_133, __s1_133, 3, 2, 1, 0); \
32421 __ret_133 = __noswap_vqdmulh_s16(__rev0_133, __noswap_splat_lane_s16(__rev1_133, __p2_133)); \
32422 __ret_133 = __builtin_shufflevector(__ret_133, __ret_133, 3, 2, 1, 0); \
32506#define vbfdot_laneq_f32(__p0_133, __p1_133, __p2_133, __p3_133) __extension__ ({ \
32507 float32x2_t __ret_133; \
32508 float32x2_t __s0_133 = __p0_133; \
32509 bfloat16x4_t __s1_133 = __p1_133; \
32510 bfloat16x8_t __s2_133 = __p2_133; \
32511 float32x2_t __rev0_133; __rev0_133 = __builtin_shufflevector(__s0_133, __s0_133, 1, 0); \
32512 bfloat16x4_t __rev1_133; __rev1_133 = __builtin_shufflevector(__s1_133, __s1_133, 3, 2, 1, 0); \
32513 bfloat16x8_t __rev2_133; __rev2_133 = __builtin_shufflevector(__s2_133, __s2_133, 7, 6, 5, 4, 3, 2, 1, 0); \
32514bfloat16x8_t __reint_133 = __rev2_133; \
32515float32x2_t __reint1_133 = __noswap_splat_laneq_f32(*(float32x4_t *) &__reint_133, __p3_133); \
32516 __ret_133 = __noswap_vbfdot_f32(__rev0_133, __rev1_133, *(bfloat16x4_t *) &__reint1_133); \
32517 __ret_133 = __builtin_shufflevector(__ret_133, __ret_133, 1, 0); \
3242332518 __ret_133; \
3242432519})
3242532520#endif
3242632521
3242732522#ifdef __LITTLE_ENDIAN__
32428#define vqrdmulhq_lane_s32(__p0_134, __p1_134, __p2_134) __extension__ ({ \
32429 int32x4_t __ret_134; \
32430 int32x4_t __s0_134 = __p0_134; \
32431 int32x2_t __s1_134 = __p1_134; \
32432 __ret_134 = vqrdmulhq_s32(__s0_134, splatq_lane_s32(__s1_134, __p2_134)); \
32433 __ret_134; \
32434})
32435#else
32436#define vqrdmulhq_lane_s32(__p0_135, __p1_135, __p2_135) __extension__ ({ \
32437 int32x4_t __ret_135; \
32438 int32x4_t __s0_135 = __p0_135; \
32439 int32x2_t __s1_135 = __p1_135; \
32440 int32x4_t __rev0_135; __rev0_135 = __builtin_shufflevector(__s0_135, __s0_135, 3, 2, 1, 0); \
32441 int32x2_t __rev1_135; __rev1_135 = __builtin_shufflevector(__s1_135, __s1_135, 1, 0); \
32442 __ret_135 = __noswap_vqrdmulhq_s32(__rev0_135, __noswap_splatq_lane_s32(__rev1_135, __p2_135)); \
32443 __ret_135 = __builtin_shufflevector(__ret_135, __ret_135, 3, 2, 1, 0); \
32444 __ret_135; \
32445})
32446#endif
32447
32448#ifdef __LITTLE_ENDIAN__
32449#define vqrdmulhq_lane_s16(__p0_136, __p1_136, __p2_136) __extension__ ({ \
32450 int16x8_t __ret_136; \
32451 int16x8_t __s0_136 = __p0_136; \
32452 int16x4_t __s1_136 = __p1_136; \
32453 __ret_136 = vqrdmulhq_s16(__s0_136, splatq_lane_s16(__s1_136, __p2_136)); \
32454 __ret_136; \
32455})
32456#else
32457#define vqrdmulhq_lane_s16(__p0_137, __p1_137, __p2_137) __extension__ ({ \
32458 int16x8_t __ret_137; \
32459 int16x8_t __s0_137 = __p0_137; \
32460 int16x4_t __s1_137 = __p1_137; \
32461 int16x8_t __rev0_137; __rev0_137 = __builtin_shufflevector(__s0_137, __s0_137, 7, 6, 5, 4, 3, 2, 1, 0); \
32462 int16x4_t __rev1_137; __rev1_137 = __builtin_shufflevector(__s1_137, __s1_137, 3, 2, 1, 0); \
32463 __ret_137 = __noswap_vqrdmulhq_s16(__rev0_137, __noswap_splatq_lane_s16(__rev1_137, __p2_137)); \
32464 __ret_137 = __builtin_shufflevector(__ret_137, __ret_137, 7, 6, 5, 4, 3, 2, 1, 0); \
32465 __ret_137; \
32466})
32467#endif
32468
32469#ifdef __LITTLE_ENDIAN__
32470#define vqrdmulh_lane_s32(__p0_138, __p1_138, __p2_138) __extension__ ({ \
32471 int32x2_t __ret_138; \
32472 int32x2_t __s0_138 = __p0_138; \
32473 int32x2_t __s1_138 = __p1_138; \
32474 __ret_138 = vqrdmulh_s32(__s0_138, splat_lane_s32(__s1_138, __p2_138)); \
32475 __ret_138; \
32476})
32477#else
32478#define vqrdmulh_lane_s32(__p0_139, __p1_139, __p2_139) __extension__ ({ \
32479 int32x2_t __ret_139; \
32480 int32x2_t __s0_139 = __p0_139; \
32481 int32x2_t __s1_139 = __p1_139; \
32482 int32x2_t __rev0_139; __rev0_139 = __builtin_shufflevector(__s0_139, __s0_139, 1, 0); \
32483 int32x2_t __rev1_139; __rev1_139 = __builtin_shufflevector(__s1_139, __s1_139, 1, 0); \
32484 __ret_139 = __noswap_vqrdmulh_s32(__rev0_139, __noswap_splat_lane_s32(__rev1_139, __p2_139)); \
32485 __ret_139 = __builtin_shufflevector(__ret_139, __ret_139, 1, 0); \
32486 __ret_139; \
32487})
32488#endif
32489
32490#ifdef __LITTLE_ENDIAN__
32491#define vqrdmulh_lane_s16(__p0_140, __p1_140, __p2_140) __extension__ ({ \
32492 int16x4_t __ret_140; \
32493 int16x4_t __s0_140 = __p0_140; \
32494 int16x4_t __s1_140 = __p1_140; \
32495 __ret_140 = vqrdmulh_s16(__s0_140, splat_lane_s16(__s1_140, __p2_140)); \
32496 __ret_140; \
32497})
32498#else
32499#define vqrdmulh_lane_s16(__p0_141, __p1_141, __p2_141) __extension__ ({ \
32500 int16x4_t __ret_141; \
32501 int16x4_t __s0_141 = __p0_141; \
32502 int16x4_t __s1_141 = __p1_141; \
32503 int16x4_t __rev0_141; __rev0_141 = __builtin_shufflevector(__s0_141, __s0_141, 3, 2, 1, 0); \
32504 int16x4_t __rev1_141; __rev1_141 = __builtin_shufflevector(__s1_141, __s1_141, 3, 2, 1, 0); \
32505 __ret_141 = __noswap_vqrdmulh_s16(__rev0_141, __noswap_splat_lane_s16(__rev1_141, __p2_141)); \
32506 __ret_141 = __builtin_shufflevector(__ret_141, __ret_141, 3, 2, 1, 0); \
32507 __ret_141; \
32508})
32509#endif
32510
32511__ai poly8x8_t vreinterpret_p8_p16(poly16x4_t __p0) {
32512 poly8x8_t __ret;
32513 __ret = (poly8x8_t)(__p0);
32514 return __ret;
32515}
32516__ai poly8x8_t vreinterpret_p8_u8(uint8x8_t __p0) {
32517 poly8x8_t __ret;
32518 __ret = (poly8x8_t)(__p0);
32519 return __ret;
32520}
32521__ai poly8x8_t vreinterpret_p8_u32(uint32x2_t __p0) {
32522 poly8x8_t __ret;
32523 __ret = (poly8x8_t)(__p0);
32524 return __ret;
32525}
32526__ai poly8x8_t vreinterpret_p8_u64(uint64x1_t __p0) {
32527 poly8x8_t __ret;
32528 __ret = (poly8x8_t)(__p0);
32529 return __ret;
32530}
32531__ai poly8x8_t vreinterpret_p8_u16(uint16x4_t __p0) {
32532 poly8x8_t __ret;
32533 __ret = (poly8x8_t)(__p0);
32534 return __ret;
32535}
32536__ai poly8x8_t vreinterpret_p8_s8(int8x8_t __p0) {
32537 poly8x8_t __ret;
32538 __ret = (poly8x8_t)(__p0);
32539 return __ret;
32540}
32541__ai poly8x8_t vreinterpret_p8_f32(float32x2_t __p0) {
32542 poly8x8_t __ret;
32543 __ret = (poly8x8_t)(__p0);
32544 return __ret;
32545}
32546__ai poly8x8_t vreinterpret_p8_f16(float16x4_t __p0) {
32547 poly8x8_t __ret;
32548 __ret = (poly8x8_t)(__p0);
32549 return __ret;
32550}
32551__ai poly8x8_t vreinterpret_p8_s32(int32x2_t __p0) {
32552 poly8x8_t __ret;
32553 __ret = (poly8x8_t)(__p0);
32554 return __ret;
32555}
32556__ai poly8x8_t vreinterpret_p8_s64(int64x1_t __p0) {
32557 poly8x8_t __ret;
32558 __ret = (poly8x8_t)(__p0);
32559 return __ret;
32560}
32561__ai poly8x8_t vreinterpret_p8_s16(int16x4_t __p0) {
32562 poly8x8_t __ret;
32563 __ret = (poly8x8_t)(__p0);
32564 return __ret;
32565}
32566__ai poly16x4_t vreinterpret_p16_p8(poly8x8_t __p0) {
32567 poly16x4_t __ret;
32568 __ret = (poly16x4_t)(__p0);
32569 return __ret;
32570}
32571__ai poly16x4_t vreinterpret_p16_u8(uint8x8_t __p0) {
32572 poly16x4_t __ret;
32573 __ret = (poly16x4_t)(__p0);
32523__ai __attribute__((target("bf16"))) float32x4_t vbfmlalbq_f32(float32x4_t __p0, bfloat16x8_t __p1, bfloat16x8_t __p2) {
32524 float32x4_t __ret;
32525 __ret = (float32x4_t) __builtin_neon_vbfmlalbq_f32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
3257432526 return __ret;
3257532527}
32576__ai poly16x4_t vreinterpret_p16_u32(uint32x2_t __p0) {
32577 poly16x4_t __ret;
32578 __ret = (poly16x4_t)(__p0);
32528#else
32529__ai __attribute__((target("bf16"))) float32x4_t vbfmlalbq_f32(float32x4_t __p0, bfloat16x8_t __p1, bfloat16x8_t __p2) {
32530 float32x4_t __ret;
32531 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
32532 bfloat16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
32533 bfloat16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
32534 __ret = (float32x4_t) __builtin_neon_vbfmlalbq_f32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 41);
32535 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3257932536 return __ret;
3258032537}
32581__ai poly16x4_t vreinterpret_p16_u64(uint64x1_t __p0) {
32582 poly16x4_t __ret;
32583 __ret = (poly16x4_t)(__p0);
32538__ai __attribute__((target("bf16"))) float32x4_t __noswap_vbfmlalbq_f32(float32x4_t __p0, bfloat16x8_t __p1, bfloat16x8_t __p2) {
32539 float32x4_t __ret;
32540 __ret = (float32x4_t) __builtin_neon_vbfmlalbq_f32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
3258432541 return __ret;
3258532542}
32586__ai poly16x4_t vreinterpret_p16_u16(uint16x4_t __p0) {
32587 poly16x4_t __ret;
32588 __ret = (poly16x4_t)(__p0);
32543#endif
32544
32545#ifdef __LITTLE_ENDIAN__
32546__ai __attribute__((target("bf16"))) float32x4_t vbfmlaltq_f32(float32x4_t __p0, bfloat16x8_t __p1, bfloat16x8_t __p2) {
32547 float32x4_t __ret;
32548 __ret = (float32x4_t) __builtin_neon_vbfmlaltq_f32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
3258932549 return __ret;
3259032550}
32591__ai poly16x4_t vreinterpret_p16_s8(int8x8_t __p0) {
32592 poly16x4_t __ret;
32593 __ret = (poly16x4_t)(__p0);
32551#else
32552__ai __attribute__((target("bf16"))) float32x4_t vbfmlaltq_f32(float32x4_t __p0, bfloat16x8_t __p1, bfloat16x8_t __p2) {
32553 float32x4_t __ret;
32554 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
32555 bfloat16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
32556 bfloat16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
32557 __ret = (float32x4_t) __builtin_neon_vbfmlaltq_f32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 41);
32558 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3259432559 return __ret;
3259532560}
32596__ai poly16x4_t vreinterpret_p16_f32(float32x2_t __p0) {
32597 poly16x4_t __ret;
32598 __ret = (poly16x4_t)(__p0);
32561__ai __attribute__((target("bf16"))) float32x4_t __noswap_vbfmlaltq_f32(float32x4_t __p0, bfloat16x8_t __p1, bfloat16x8_t __p2) {
32562 float32x4_t __ret;
32563 __ret = (float32x4_t) __builtin_neon_vbfmlaltq_f32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
3259932564 return __ret;
3260032565}
32601__ai poly16x4_t vreinterpret_p16_f16(float16x4_t __p0) {
32602 poly16x4_t __ret;
32603 __ret = (poly16x4_t)(__p0);
32566#endif
32567
32568#ifdef __LITTLE_ENDIAN__
32569__ai __attribute__((target("bf16"))) float32x4_t vbfmmlaq_f32(float32x4_t __p0, bfloat16x8_t __p1, bfloat16x8_t __p2) {
32570 float32x4_t __ret;
32571 __ret = (float32x4_t) __builtin_neon_vbfmmlaq_f32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
3260432572 return __ret;
3260532573}
32606__ai poly16x4_t vreinterpret_p16_s32(int32x2_t __p0) {
32607 poly16x4_t __ret;
32608 __ret = (poly16x4_t)(__p0);
32574#else
32575__ai __attribute__((target("bf16"))) float32x4_t vbfmmlaq_f32(float32x4_t __p0, bfloat16x8_t __p1, bfloat16x8_t __p2) {
32576 float32x4_t __ret;
32577 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
32578 bfloat16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
32579 bfloat16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
32580 __ret = (float32x4_t) __builtin_neon_vbfmmlaq_f32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 41);
32581 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3260932582 return __ret;
3261032583}
32611__ai poly16x4_t vreinterpret_p16_s64(int64x1_t __p0) {
32612 poly16x4_t __ret;
32613 __ret = (poly16x4_t)(__p0);
32584#endif
32585
32586#ifdef __LITTLE_ENDIAN__
32587__ai __attribute__((target("bf16"))) bfloat16x8_t vcombine_bf16(bfloat16x4_t __p0, bfloat16x4_t __p1) {
32588 bfloat16x8_t __ret;
32589 __ret = __builtin_shufflevector(__p0, __p1, 0, 1, 2, 3, 4, 5, 6, 7);
3261432590 return __ret;
3261532591}
32616__ai poly16x4_t vreinterpret_p16_s16(int16x4_t __p0) {
32617 poly16x4_t __ret;
32618 __ret = (poly16x4_t)(__p0);
32592#else
32593__ai __attribute__((target("bf16"))) bfloat16x8_t vcombine_bf16(bfloat16x4_t __p0, bfloat16x4_t __p1) {
32594 bfloat16x8_t __ret;
32595 bfloat16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
32596 bfloat16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
32597 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 1, 2, 3, 4, 5, 6, 7);
32598 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
3261932599 return __ret;
3262032600}
32621__ai poly8x16_t vreinterpretq_p8_p16(poly16x8_t __p0) {
32622 poly8x16_t __ret;
32623 __ret = (poly8x16_t)(__p0);
32601__ai __attribute__((target("bf16"))) bfloat16x8_t __noswap_vcombine_bf16(bfloat16x4_t __p0, bfloat16x4_t __p1) {
32602 bfloat16x8_t __ret;
32603 __ret = __builtin_shufflevector(__p0, __p1, 0, 1, 2, 3, 4, 5, 6, 7);
3262432604 return __ret;
3262532605}
32626__ai poly8x16_t vreinterpretq_p8_u8(uint8x16_t __p0) {
32627 poly8x16_t __ret;
32628 __ret = (poly8x16_t)(__p0);
32629 return __ret;
32606#endif
32607
32608#define vcreate_bf16(__p0) __extension__ ({ \
32609 bfloat16x4_t __ret; \
32610 uint64_t __promote = __p0; \
32611 __ret = (bfloat16x4_t)(__promote); \
32612 __ret; \
32613})
32614#ifdef __LITTLE_ENDIAN__
32615__ai __attribute__((target("bf16"))) float32x4_t vcvt_f32_bf16(bfloat16x4_t __p0_134) {
32616 float32x4_t __ret_134;
32617bfloat16x4_t __reint_134 = __p0_134;
32618int32x4_t __reint1_134 = vshll_n_s16(*(int16x4_t *) &__reint_134, 16);
32619 __ret_134 = *(float32x4_t *) &__reint1_134;
32620 return __ret_134;
3263032621}
32631__ai poly8x16_t vreinterpretq_p8_u32(uint32x4_t __p0) {
32632 poly8x16_t __ret;
32633 __ret = (poly8x16_t)(__p0);
32634 return __ret;
32622#else
32623__ai __attribute__((target("bf16"))) float32x4_t vcvt_f32_bf16(bfloat16x4_t __p0_135) {
32624 float32x4_t __ret_135;
32625 bfloat16x4_t __rev0_135; __rev0_135 = __builtin_shufflevector(__p0_135, __p0_135, 3, 2, 1, 0);
32626bfloat16x4_t __reint_135 = __rev0_135;
32627int32x4_t __reint1_135 = __noswap_vshll_n_s16(*(int16x4_t *) &__reint_135, 16);
32628 __ret_135 = *(float32x4_t *) &__reint1_135;
32629 __ret_135 = __builtin_shufflevector(__ret_135, __ret_135, 3, 2, 1, 0);
32630 return __ret_135;
3263532631}
32636__ai poly8x16_t vreinterpretq_p8_u64(uint64x2_t __p0) {
32637 poly8x16_t __ret;
32638 __ret = (poly8x16_t)(__p0);
32639 return __ret;
32632__ai __attribute__((target("bf16"))) float32x4_t __noswap_vcvt_f32_bf16(bfloat16x4_t __p0_136) {
32633 float32x4_t __ret_136;
32634bfloat16x4_t __reint_136 = __p0_136;
32635int32x4_t __reint1_136 = __noswap_vshll_n_s16(*(int16x4_t *) &__reint_136, 16);
32636 __ret_136 = *(float32x4_t *) &__reint1_136;
32637 return __ret_136;
3264032638}
32641__ai poly8x16_t vreinterpretq_p8_u16(uint16x8_t __p0) {
32642 poly8x16_t __ret;
32643 __ret = (poly8x16_t)(__p0);
32639#endif
32640
32641__ai __attribute__((target("bf16"))) float32_t vcvtah_f32_bf16(bfloat16_t __p0) {
32642 float32_t __ret;
32643bfloat16_t __reint = __p0;
32644int32_t __reint1 = *(int32_t *) &__reint << 16;
32645 __ret = *(float32_t *) &__reint1;
3264432646 return __ret;
3264532647}
32646__ai poly8x16_t vreinterpretq_p8_s8(int8x16_t __p0) {
32647 poly8x16_t __ret;
32648 __ret = (poly8x16_t)(__p0);
32648__ai __attribute__((target("bf16"))) bfloat16_t vcvth_bf16_f32(float32_t __p0) {
32649 bfloat16_t __ret;
32650 __ret = (bfloat16_t) __builtin_neon_vcvth_bf16_f32(__p0);
3264932651 return __ret;
3265032652}
32651__ai poly8x16_t vreinterpretq_p8_f32(float32x4_t __p0) {
32652 poly8x16_t __ret;
32653 __ret = (poly8x16_t)(__p0);
32653#ifdef __LITTLE_ENDIAN__
32654#define vduph_lane_bf16(__p0, __p1) __extension__ ({ \
32655 bfloat16_t __ret; \
32656 bfloat16x4_t __s0 = __p0; \
32657 __ret = (bfloat16_t) __builtin_neon_vduph_lane_bf16((bfloat16x4_t)__s0, __p1); \
32658 __ret; \
32659})
32660#else
32661#define vduph_lane_bf16(__p0, __p1) __extension__ ({ \
32662 bfloat16_t __ret; \
32663 bfloat16x4_t __s0 = __p0; \
32664 bfloat16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
32665 __ret = (bfloat16_t) __builtin_neon_vduph_lane_bf16((bfloat16x4_t)__rev0, __p1); \
32666 __ret; \
32667})
32668#endif
32669
32670#ifdef __LITTLE_ENDIAN__
32671#define vdupq_lane_bf16(__p0_137, __p1_137) __extension__ ({ \
32672 bfloat16x8_t __ret_137; \
32673 bfloat16x4_t __s0_137 = __p0_137; \
32674 __ret_137 = splatq_lane_bf16(__s0_137, __p1_137); \
32675 __ret_137; \
32676})
32677#else
32678#define vdupq_lane_bf16(__p0_138, __p1_138) __extension__ ({ \
32679 bfloat16x8_t __ret_138; \
32680 bfloat16x4_t __s0_138 = __p0_138; \
32681 bfloat16x4_t __rev0_138; __rev0_138 = __builtin_shufflevector(__s0_138, __s0_138, 3, 2, 1, 0); \
32682 __ret_138 = __noswap_splatq_lane_bf16(__rev0_138, __p1_138); \
32683 __ret_138 = __builtin_shufflevector(__ret_138, __ret_138, 7, 6, 5, 4, 3, 2, 1, 0); \
32684 __ret_138; \
32685})
32686#endif
32687
32688#ifdef __LITTLE_ENDIAN__
32689#define vdup_lane_bf16(__p0_139, __p1_139) __extension__ ({ \
32690 bfloat16x4_t __ret_139; \
32691 bfloat16x4_t __s0_139 = __p0_139; \
32692 __ret_139 = splat_lane_bf16(__s0_139, __p1_139); \
32693 __ret_139; \
32694})
32695#else
32696#define vdup_lane_bf16(__p0_140, __p1_140) __extension__ ({ \
32697 bfloat16x4_t __ret_140; \
32698 bfloat16x4_t __s0_140 = __p0_140; \
32699 bfloat16x4_t __rev0_140; __rev0_140 = __builtin_shufflevector(__s0_140, __s0_140, 3, 2, 1, 0); \
32700 __ret_140 = __noswap_splat_lane_bf16(__rev0_140, __p1_140); \
32701 __ret_140 = __builtin_shufflevector(__ret_140, __ret_140, 3, 2, 1, 0); \
32702 __ret_140; \
32703})
32704#endif
32705
32706#ifdef __LITTLE_ENDIAN__
32707#define vduph_laneq_bf16(__p0, __p1) __extension__ ({ \
32708 bfloat16_t __ret; \
32709 bfloat16x8_t __s0 = __p0; \
32710 __ret = (bfloat16_t) __builtin_neon_vduph_laneq_bf16((bfloat16x8_t)__s0, __p1); \
32711 __ret; \
32712})
32713#else
32714#define vduph_laneq_bf16(__p0, __p1) __extension__ ({ \
32715 bfloat16_t __ret; \
32716 bfloat16x8_t __s0 = __p0; \
32717 bfloat16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
32718 __ret = (bfloat16_t) __builtin_neon_vduph_laneq_bf16((bfloat16x8_t)__rev0, __p1); \
32719 __ret; \
32720})
32721#endif
32722
32723#ifdef __LITTLE_ENDIAN__
32724#define vdupq_laneq_bf16(__p0_141, __p1_141) __extension__ ({ \
32725 bfloat16x8_t __ret_141; \
32726 bfloat16x8_t __s0_141 = __p0_141; \
32727 __ret_141 = splatq_laneq_bf16(__s0_141, __p1_141); \
32728 __ret_141; \
32729})
32730#else
32731#define vdupq_laneq_bf16(__p0_142, __p1_142) __extension__ ({ \
32732 bfloat16x8_t __ret_142; \
32733 bfloat16x8_t __s0_142 = __p0_142; \
32734 bfloat16x8_t __rev0_142; __rev0_142 = __builtin_shufflevector(__s0_142, __s0_142, 7, 6, 5, 4, 3, 2, 1, 0); \
32735 __ret_142 = __noswap_splatq_laneq_bf16(__rev0_142, __p1_142); \
32736 __ret_142 = __builtin_shufflevector(__ret_142, __ret_142, 7, 6, 5, 4, 3, 2, 1, 0); \
32737 __ret_142; \
32738})
32739#endif
32740
32741#ifdef __LITTLE_ENDIAN__
32742#define vdup_laneq_bf16(__p0_143, __p1_143) __extension__ ({ \
32743 bfloat16x4_t __ret_143; \
32744 bfloat16x8_t __s0_143 = __p0_143; \
32745 __ret_143 = splat_laneq_bf16(__s0_143, __p1_143); \
32746 __ret_143; \
32747})
32748#else
32749#define vdup_laneq_bf16(__p0_144, __p1_144) __extension__ ({ \
32750 bfloat16x4_t __ret_144; \
32751 bfloat16x8_t __s0_144 = __p0_144; \
32752 bfloat16x8_t __rev0_144; __rev0_144 = __builtin_shufflevector(__s0_144, __s0_144, 7, 6, 5, 4, 3, 2, 1, 0); \
32753 __ret_144 = __noswap_splat_laneq_bf16(__rev0_144, __p1_144); \
32754 __ret_144 = __builtin_shufflevector(__ret_144, __ret_144, 3, 2, 1, 0); \
32755 __ret_144; \
32756})
32757#endif
32758
32759#ifdef __LITTLE_ENDIAN__
32760__ai __attribute__((target("bf16"))) bfloat16x8_t vdupq_n_bf16(bfloat16_t __p0) {
32761 bfloat16x8_t __ret;
32762 __ret = (bfloat16x8_t) {__p0, __p0, __p0, __p0, __p0, __p0, __p0, __p0};
3265432763 return __ret;
3265532764}
32656__ai poly8x16_t vreinterpretq_p8_f16(float16x8_t __p0) {
32657 poly8x16_t __ret;
32658 __ret = (poly8x16_t)(__p0);
32765#else
32766__ai __attribute__((target("bf16"))) bfloat16x8_t vdupq_n_bf16(bfloat16_t __p0) {
32767 bfloat16x8_t __ret;
32768 __ret = (bfloat16x8_t) {__p0, __p0, __p0, __p0, __p0, __p0, __p0, __p0};
32769 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
3265932770 return __ret;
3266032771}
32661__ai poly8x16_t vreinterpretq_p8_s32(int32x4_t __p0) {
32662 poly8x16_t __ret;
32663 __ret = (poly8x16_t)(__p0);
32772#endif
32773
32774#ifdef __LITTLE_ENDIAN__
32775__ai __attribute__((target("bf16"))) bfloat16x4_t vdup_n_bf16(bfloat16_t __p0) {
32776 bfloat16x4_t __ret;
32777 __ret = (bfloat16x4_t) {__p0, __p0, __p0, __p0};
3266432778 return __ret;
3266532779}
32666__ai poly8x16_t vreinterpretq_p8_s64(int64x2_t __p0) {
32667 poly8x16_t __ret;
32668 __ret = (poly8x16_t)(__p0);
32780#else
32781__ai __attribute__((target("bf16"))) bfloat16x4_t vdup_n_bf16(bfloat16_t __p0) {
32782 bfloat16x4_t __ret;
32783 __ret = (bfloat16x4_t) {__p0, __p0, __p0, __p0};
32784 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3266932785 return __ret;
3267032786}
32671__ai poly8x16_t vreinterpretq_p8_s16(int16x8_t __p0) {
32672 poly8x16_t __ret;
32673 __ret = (poly8x16_t)(__p0);
32787#endif
32788
32789#ifdef __LITTLE_ENDIAN__
32790__ai __attribute__((target("bf16"))) bfloat16x4_t vget_high_bf16(bfloat16x8_t __p0) {
32791 bfloat16x4_t __ret;
32792 __ret = __builtin_shufflevector(__p0, __p0, 4, 5, 6, 7);
3267432793 return __ret;
3267532794}
32676__ai poly16x8_t vreinterpretq_p16_p8(poly8x16_t __p0) {
32677 poly16x8_t __ret;
32678 __ret = (poly16x8_t)(__p0);
32795#else
32796__ai __attribute__((target("bf16"))) bfloat16x4_t vget_high_bf16(bfloat16x8_t __p0) {
32797 bfloat16x4_t __ret;
32798 bfloat16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
32799 __ret = __builtin_shufflevector(__rev0, __rev0, 4, 5, 6, 7);
32800 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3267932801 return __ret;
3268032802}
32681__ai poly16x8_t vreinterpretq_p16_u8(uint8x16_t __p0) {
32682 poly16x8_t __ret;
32683 __ret = (poly16x8_t)(__p0);
32803__ai __attribute__((target("bf16"))) bfloat16x4_t __noswap_vget_high_bf16(bfloat16x8_t __p0) {
32804 bfloat16x4_t __ret;
32805 __ret = __builtin_shufflevector(__p0, __p0, 4, 5, 6, 7);
3268432806 return __ret;
3268532807}
32686__ai poly16x8_t vreinterpretq_p16_u32(uint32x4_t __p0) {
32687 poly16x8_t __ret;
32688 __ret = (poly16x8_t)(__p0);
32808#endif
32809
32810#ifdef __LITTLE_ENDIAN__
32811#define vgetq_lane_bf16(__p0, __p1) __extension__ ({ \
32812 bfloat16_t __ret; \
32813 bfloat16x8_t __s0 = __p0; \
32814 __ret = (bfloat16_t) __builtin_neon_vgetq_lane_bf16((bfloat16x8_t)__s0, __p1); \
32815 __ret; \
32816})
32817#else
32818#define vgetq_lane_bf16(__p0, __p1) __extension__ ({ \
32819 bfloat16_t __ret; \
32820 bfloat16x8_t __s0 = __p0; \
32821 bfloat16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
32822 __ret = (bfloat16_t) __builtin_neon_vgetq_lane_bf16((bfloat16x8_t)__rev0, __p1); \
32823 __ret; \
32824})
32825#define __noswap_vgetq_lane_bf16(__p0, __p1) __extension__ ({ \
32826 bfloat16_t __ret; \
32827 bfloat16x8_t __s0 = __p0; \
32828 __ret = (bfloat16_t) __builtin_neon_vgetq_lane_bf16((bfloat16x8_t)__s0, __p1); \
32829 __ret; \
32830})
32831#endif
32832
32833#ifdef __LITTLE_ENDIAN__
32834#define vget_lane_bf16(__p0, __p1) __extension__ ({ \
32835 bfloat16_t __ret; \
32836 bfloat16x4_t __s0 = __p0; \
32837 __ret = (bfloat16_t) __builtin_neon_vget_lane_bf16((bfloat16x4_t)__s0, __p1); \
32838 __ret; \
32839})
32840#else
32841#define vget_lane_bf16(__p0, __p1) __extension__ ({ \
32842 bfloat16_t __ret; \
32843 bfloat16x4_t __s0 = __p0; \
32844 bfloat16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
32845 __ret = (bfloat16_t) __builtin_neon_vget_lane_bf16((bfloat16x4_t)__rev0, __p1); \
32846 __ret; \
32847})
32848#define __noswap_vget_lane_bf16(__p0, __p1) __extension__ ({ \
32849 bfloat16_t __ret; \
32850 bfloat16x4_t __s0 = __p0; \
32851 __ret = (bfloat16_t) __builtin_neon_vget_lane_bf16((bfloat16x4_t)__s0, __p1); \
32852 __ret; \
32853})
32854#endif
32855
32856#ifdef __LITTLE_ENDIAN__
32857__ai __attribute__((target("bf16"))) bfloat16x4_t vget_low_bf16(bfloat16x8_t __p0) {
32858 bfloat16x4_t __ret;
32859 __ret = __builtin_shufflevector(__p0, __p0, 0, 1, 2, 3);
3268932860 return __ret;
3269032861}
32691__ai poly16x8_t vreinterpretq_p16_u64(uint64x2_t __p0) {
32692 poly16x8_t __ret;
32693 __ret = (poly16x8_t)(__p0);
32862#else
32863__ai __attribute__((target("bf16"))) bfloat16x4_t vget_low_bf16(bfloat16x8_t __p0) {
32864 bfloat16x4_t __ret;
32865 bfloat16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
32866 __ret = __builtin_shufflevector(__rev0, __rev0, 0, 1, 2, 3);
32867 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3269432868 return __ret;
3269532869}
32696__ai poly16x8_t vreinterpretq_p16_u16(uint16x8_t __p0) {
32697 poly16x8_t __ret;
32698 __ret = (poly16x8_t)(__p0);
32870__ai __attribute__((target("bf16"))) bfloat16x4_t __noswap_vget_low_bf16(bfloat16x8_t __p0) {
32871 bfloat16x4_t __ret;
32872 __ret = __builtin_shufflevector(__p0, __p0, 0, 1, 2, 3);
3269932873 return __ret;
3270032874}
32701__ai poly16x8_t vreinterpretq_p16_s8(int8x16_t __p0) {
32702 poly16x8_t __ret;
32703 __ret = (poly16x8_t)(__p0);
32704 return __ret;
32705}
32706__ai poly16x8_t vreinterpretq_p16_f32(float32x4_t __p0) {
32707 poly16x8_t __ret;
32708 __ret = (poly16x8_t)(__p0);
32709 return __ret;
32710}
32711__ai poly16x8_t vreinterpretq_p16_f16(float16x8_t __p0) {
32712 poly16x8_t __ret;
32713 __ret = (poly16x8_t)(__p0);
32714 return __ret;
32715}
32716__ai poly16x8_t vreinterpretq_p16_s32(int32x4_t __p0) {
32717 poly16x8_t __ret;
32718 __ret = (poly16x8_t)(__p0);
32719 return __ret;
32720}
32721__ai poly16x8_t vreinterpretq_p16_s64(int64x2_t __p0) {
32722 poly16x8_t __ret;
32723 __ret = (poly16x8_t)(__p0);
32724 return __ret;
32725}
32726__ai poly16x8_t vreinterpretq_p16_s16(int16x8_t __p0) {
32727 poly16x8_t __ret;
32728 __ret = (poly16x8_t)(__p0);
32729 return __ret;
32730}
32731__ai uint8x16_t vreinterpretq_u8_p8(poly8x16_t __p0) {
32732 uint8x16_t __ret;
32733 __ret = (uint8x16_t)(__p0);
32734 return __ret;
32735}
32736__ai uint8x16_t vreinterpretq_u8_p16(poly16x8_t __p0) {
32737 uint8x16_t __ret;
32738 __ret = (uint8x16_t)(__p0);
32739 return __ret;
32740}
32741__ai uint8x16_t vreinterpretq_u8_u32(uint32x4_t __p0) {
32742 uint8x16_t __ret;
32743 __ret = (uint8x16_t)(__p0);
32744 return __ret;
32745}
32746__ai uint8x16_t vreinterpretq_u8_u64(uint64x2_t __p0) {
32747 uint8x16_t __ret;
32748 __ret = (uint8x16_t)(__p0);
32749 return __ret;
32750}
32751__ai uint8x16_t vreinterpretq_u8_u16(uint16x8_t __p0) {
32752 uint8x16_t __ret;
32753 __ret = (uint8x16_t)(__p0);
32754 return __ret;
32755}
32756__ai uint8x16_t vreinterpretq_u8_s8(int8x16_t __p0) {
32757 uint8x16_t __ret;
32758 __ret = (uint8x16_t)(__p0);
32759 return __ret;
32760}
32761__ai uint8x16_t vreinterpretq_u8_f32(float32x4_t __p0) {
32762 uint8x16_t __ret;
32763 __ret = (uint8x16_t)(__p0);
32764 return __ret;
32765}
32766__ai uint8x16_t vreinterpretq_u8_f16(float16x8_t __p0) {
32767 uint8x16_t __ret;
32768 __ret = (uint8x16_t)(__p0);
32769 return __ret;
32770}
32771__ai uint8x16_t vreinterpretq_u8_s32(int32x4_t __p0) {
32772 uint8x16_t __ret;
32773 __ret = (uint8x16_t)(__p0);
32774 return __ret;
32775}
32776__ai uint8x16_t vreinterpretq_u8_s64(int64x2_t __p0) {
32777 uint8x16_t __ret;
32778 __ret = (uint8x16_t)(__p0);
32779 return __ret;
32780}
32781__ai uint8x16_t vreinterpretq_u8_s16(int16x8_t __p0) {
32782 uint8x16_t __ret;
32783 __ret = (uint8x16_t)(__p0);
32784 return __ret;
32785}
32786__ai uint32x4_t vreinterpretq_u32_p8(poly8x16_t __p0) {
32787 uint32x4_t __ret;
32788 __ret = (uint32x4_t)(__p0);
32789 return __ret;
32790}
32791__ai uint32x4_t vreinterpretq_u32_p16(poly16x8_t __p0) {
32792 uint32x4_t __ret;
32793 __ret = (uint32x4_t)(__p0);
32794 return __ret;
32795}
32796__ai uint32x4_t vreinterpretq_u32_u8(uint8x16_t __p0) {
32797 uint32x4_t __ret;
32798 __ret = (uint32x4_t)(__p0);
32799 return __ret;
32800}
32801__ai uint32x4_t vreinterpretq_u32_u64(uint64x2_t __p0) {
32802 uint32x4_t __ret;
32803 __ret = (uint32x4_t)(__p0);
32804 return __ret;
32805}
32806__ai uint32x4_t vreinterpretq_u32_u16(uint16x8_t __p0) {
32807 uint32x4_t __ret;
32808 __ret = (uint32x4_t)(__p0);
32809 return __ret;
32810}
32811__ai uint32x4_t vreinterpretq_u32_s8(int8x16_t __p0) {
32812 uint32x4_t __ret;
32813 __ret = (uint32x4_t)(__p0);
32814 return __ret;
32815}
32816__ai uint32x4_t vreinterpretq_u32_f32(float32x4_t __p0) {
32817 uint32x4_t __ret;
32818 __ret = (uint32x4_t)(__p0);
32819 return __ret;
32820}
32821__ai uint32x4_t vreinterpretq_u32_f16(float16x8_t __p0) {
32822 uint32x4_t __ret;
32823 __ret = (uint32x4_t)(__p0);
32824 return __ret;
32825}
32826__ai uint32x4_t vreinterpretq_u32_s32(int32x4_t __p0) {
32827 uint32x4_t __ret;
32828 __ret = (uint32x4_t)(__p0);
32829 return __ret;
32830}
32831__ai uint32x4_t vreinterpretq_u32_s64(int64x2_t __p0) {
32832 uint32x4_t __ret;
32833 __ret = (uint32x4_t)(__p0);
32834 return __ret;
32835}
32836__ai uint32x4_t vreinterpretq_u32_s16(int16x8_t __p0) {
32837 uint32x4_t __ret;
32838 __ret = (uint32x4_t)(__p0);
32839 return __ret;
32840}
32841__ai uint64x2_t vreinterpretq_u64_p8(poly8x16_t __p0) {
32842 uint64x2_t __ret;
32843 __ret = (uint64x2_t)(__p0);
32844 return __ret;
32845}
32846__ai uint64x2_t vreinterpretq_u64_p16(poly16x8_t __p0) {
32847 uint64x2_t __ret;
32848 __ret = (uint64x2_t)(__p0);
32849 return __ret;
32850}
32851__ai uint64x2_t vreinterpretq_u64_u8(uint8x16_t __p0) {
32852 uint64x2_t __ret;
32853 __ret = (uint64x2_t)(__p0);
32854 return __ret;
32855}
32856__ai uint64x2_t vreinterpretq_u64_u32(uint32x4_t __p0) {
32857 uint64x2_t __ret;
32858 __ret = (uint64x2_t)(__p0);
32859 return __ret;
32860}
32861__ai uint64x2_t vreinterpretq_u64_u16(uint16x8_t __p0) {
32862 uint64x2_t __ret;
32863 __ret = (uint64x2_t)(__p0);
32864 return __ret;
32865}
32866__ai uint64x2_t vreinterpretq_u64_s8(int8x16_t __p0) {
32867 uint64x2_t __ret;
32868 __ret = (uint64x2_t)(__p0);
32869 return __ret;
32870}
32871__ai uint64x2_t vreinterpretq_u64_f32(float32x4_t __p0) {
32872 uint64x2_t __ret;
32873 __ret = (uint64x2_t)(__p0);
32874 return __ret;
32875}
32876__ai uint64x2_t vreinterpretq_u64_f16(float16x8_t __p0) {
32877 uint64x2_t __ret;
32878 __ret = (uint64x2_t)(__p0);
32879 return __ret;
32880}
32881__ai uint64x2_t vreinterpretq_u64_s32(int32x4_t __p0) {
32882 uint64x2_t __ret;
32883 __ret = (uint64x2_t)(__p0);
32884 return __ret;
32885}
32886__ai uint64x2_t vreinterpretq_u64_s64(int64x2_t __p0) {
32887 uint64x2_t __ret;
32888 __ret = (uint64x2_t)(__p0);
32889 return __ret;
32890}
32891__ai uint64x2_t vreinterpretq_u64_s16(int16x8_t __p0) {
32892 uint64x2_t __ret;
32893 __ret = (uint64x2_t)(__p0);
32894 return __ret;
32895}
32896__ai uint16x8_t vreinterpretq_u16_p8(poly8x16_t __p0) {
32897 uint16x8_t __ret;
32898 __ret = (uint16x8_t)(__p0);
32899 return __ret;
32900}
32901__ai uint16x8_t vreinterpretq_u16_p16(poly16x8_t __p0) {
32902 uint16x8_t __ret;
32903 __ret = (uint16x8_t)(__p0);
32904 return __ret;
32905}
32906__ai uint16x8_t vreinterpretq_u16_u8(uint8x16_t __p0) {
32907 uint16x8_t __ret;
32908 __ret = (uint16x8_t)(__p0);
32909 return __ret;
32910}
32911__ai uint16x8_t vreinterpretq_u16_u32(uint32x4_t __p0) {
32912 uint16x8_t __ret;
32913 __ret = (uint16x8_t)(__p0);
32914 return __ret;
32915}
32916__ai uint16x8_t vreinterpretq_u16_u64(uint64x2_t __p0) {
32917 uint16x8_t __ret;
32918 __ret = (uint16x8_t)(__p0);
32919 return __ret;
32920}
32921__ai uint16x8_t vreinterpretq_u16_s8(int8x16_t __p0) {
32922 uint16x8_t __ret;
32923 __ret = (uint16x8_t)(__p0);
32924 return __ret;
32925}
32926__ai uint16x8_t vreinterpretq_u16_f32(float32x4_t __p0) {
32927 uint16x8_t __ret;
32928 __ret = (uint16x8_t)(__p0);
32929 return __ret;
32930}
32931__ai uint16x8_t vreinterpretq_u16_f16(float16x8_t __p0) {
32932 uint16x8_t __ret;
32933 __ret = (uint16x8_t)(__p0);
32934 return __ret;
32935}
32936__ai uint16x8_t vreinterpretq_u16_s32(int32x4_t __p0) {
32937 uint16x8_t __ret;
32938 __ret = (uint16x8_t)(__p0);
32939 return __ret;
32940}
32941__ai uint16x8_t vreinterpretq_u16_s64(int64x2_t __p0) {
32942 uint16x8_t __ret;
32943 __ret = (uint16x8_t)(__p0);
32944 return __ret;
32945}
32946__ai uint16x8_t vreinterpretq_u16_s16(int16x8_t __p0) {
32947 uint16x8_t __ret;
32948 __ret = (uint16x8_t)(__p0);
32949 return __ret;
32950}
32951__ai int8x16_t vreinterpretq_s8_p8(poly8x16_t __p0) {
32952 int8x16_t __ret;
32953 __ret = (int8x16_t)(__p0);
32954 return __ret;
32955}
32956__ai int8x16_t vreinterpretq_s8_p16(poly16x8_t __p0) {
32957 int8x16_t __ret;
32958 __ret = (int8x16_t)(__p0);
32959 return __ret;
32960}
32961__ai int8x16_t vreinterpretq_s8_u8(uint8x16_t __p0) {
32962 int8x16_t __ret;
32963 __ret = (int8x16_t)(__p0);
32964 return __ret;
32965}
32966__ai int8x16_t vreinterpretq_s8_u32(uint32x4_t __p0) {
32967 int8x16_t __ret;
32968 __ret = (int8x16_t)(__p0);
32969 return __ret;
32970}
32971__ai int8x16_t vreinterpretq_s8_u64(uint64x2_t __p0) {
32972 int8x16_t __ret;
32973 __ret = (int8x16_t)(__p0);
32974 return __ret;
32975}
32976__ai int8x16_t vreinterpretq_s8_u16(uint16x8_t __p0) {
32977 int8x16_t __ret;
32978 __ret = (int8x16_t)(__p0);
32979 return __ret;
32980}
32981__ai int8x16_t vreinterpretq_s8_f32(float32x4_t __p0) {
32982 int8x16_t __ret;
32983 __ret = (int8x16_t)(__p0);
32984 return __ret;
32985}
32986__ai int8x16_t vreinterpretq_s8_f16(float16x8_t __p0) {
32987 int8x16_t __ret;
32988 __ret = (int8x16_t)(__p0);
32989 return __ret;
32990}
32991__ai int8x16_t vreinterpretq_s8_s32(int32x4_t __p0) {
32992 int8x16_t __ret;
32993 __ret = (int8x16_t)(__p0);
32994 return __ret;
32995}
32996__ai int8x16_t vreinterpretq_s8_s64(int64x2_t __p0) {
32997 int8x16_t __ret;
32998 __ret = (int8x16_t)(__p0);
32999 return __ret;
33000}
33001__ai int8x16_t vreinterpretq_s8_s16(int16x8_t __p0) {
33002 int8x16_t __ret;
33003 __ret = (int8x16_t)(__p0);
33004 return __ret;
33005}
33006__ai float32x4_t vreinterpretq_f32_p8(poly8x16_t __p0) {
33007 float32x4_t __ret;
33008 __ret = (float32x4_t)(__p0);
33009 return __ret;
33010}
33011__ai float32x4_t vreinterpretq_f32_p16(poly16x8_t __p0) {
33012 float32x4_t __ret;
33013 __ret = (float32x4_t)(__p0);
33014 return __ret;
33015}
33016__ai float32x4_t vreinterpretq_f32_u8(uint8x16_t __p0) {
33017 float32x4_t __ret;
33018 __ret = (float32x4_t)(__p0);
33019 return __ret;
33020}
33021__ai float32x4_t vreinterpretq_f32_u32(uint32x4_t __p0) {
33022 float32x4_t __ret;
33023 __ret = (float32x4_t)(__p0);
33024 return __ret;
33025}
33026__ai float32x4_t vreinterpretq_f32_u64(uint64x2_t __p0) {
33027 float32x4_t __ret;
33028 __ret = (float32x4_t)(__p0);
33029 return __ret;
33030}
33031__ai float32x4_t vreinterpretq_f32_u16(uint16x8_t __p0) {
33032 float32x4_t __ret;
33033 __ret = (float32x4_t)(__p0);
33034 return __ret;
33035}
33036__ai float32x4_t vreinterpretq_f32_s8(int8x16_t __p0) {
33037 float32x4_t __ret;
33038 __ret = (float32x4_t)(__p0);
33039 return __ret;
33040}
33041__ai float32x4_t vreinterpretq_f32_f16(float16x8_t __p0) {
33042 float32x4_t __ret;
33043 __ret = (float32x4_t)(__p0);
33044 return __ret;
33045}
33046__ai float32x4_t vreinterpretq_f32_s32(int32x4_t __p0) {
33047 float32x4_t __ret;
33048 __ret = (float32x4_t)(__p0);
33049 return __ret;
33050}
33051__ai float32x4_t vreinterpretq_f32_s64(int64x2_t __p0) {
33052 float32x4_t __ret;
33053 __ret = (float32x4_t)(__p0);
33054 return __ret;
33055}
33056__ai float32x4_t vreinterpretq_f32_s16(int16x8_t __p0) {
33057 float32x4_t __ret;
33058 __ret = (float32x4_t)(__p0);
33059 return __ret;
33060}
33061__ai float16x8_t vreinterpretq_f16_p8(poly8x16_t __p0) {
33062 float16x8_t __ret;
33063 __ret = (float16x8_t)(__p0);
33064 return __ret;
33065}
33066__ai float16x8_t vreinterpretq_f16_p16(poly16x8_t __p0) {
33067 float16x8_t __ret;
33068 __ret = (float16x8_t)(__p0);
33069 return __ret;
33070}
33071__ai float16x8_t vreinterpretq_f16_u8(uint8x16_t __p0) {
33072 float16x8_t __ret;
33073 __ret = (float16x8_t)(__p0);
33074 return __ret;
33075}
33076__ai float16x8_t vreinterpretq_f16_u32(uint32x4_t __p0) {
33077 float16x8_t __ret;
33078 __ret = (float16x8_t)(__p0);
33079 return __ret;
33080}
33081__ai float16x8_t vreinterpretq_f16_u64(uint64x2_t __p0) {
33082 float16x8_t __ret;
33083 __ret = (float16x8_t)(__p0);
33084 return __ret;
33085}
33086__ai float16x8_t vreinterpretq_f16_u16(uint16x8_t __p0) {
33087 float16x8_t __ret;
33088 __ret = (float16x8_t)(__p0);
33089 return __ret;
33090}
33091__ai float16x8_t vreinterpretq_f16_s8(int8x16_t __p0) {
33092 float16x8_t __ret;
33093 __ret = (float16x8_t)(__p0);
33094 return __ret;
33095}
33096__ai float16x8_t vreinterpretq_f16_f32(float32x4_t __p0) {
33097 float16x8_t __ret;
33098 __ret = (float16x8_t)(__p0);
33099 return __ret;
33100}
33101__ai float16x8_t vreinterpretq_f16_s32(int32x4_t __p0) {
33102 float16x8_t __ret;
33103 __ret = (float16x8_t)(__p0);
33104 return __ret;
33105}
33106__ai float16x8_t vreinterpretq_f16_s64(int64x2_t __p0) {
33107 float16x8_t __ret;
33108 __ret = (float16x8_t)(__p0);
33109 return __ret;
33110}
33111__ai float16x8_t vreinterpretq_f16_s16(int16x8_t __p0) {
33112 float16x8_t __ret;
33113 __ret = (float16x8_t)(__p0);
33114 return __ret;
33115}
33116__ai int32x4_t vreinterpretq_s32_p8(poly8x16_t __p0) {
33117 int32x4_t __ret;
33118 __ret = (int32x4_t)(__p0);
33119 return __ret;
33120}
33121__ai int32x4_t vreinterpretq_s32_p16(poly16x8_t __p0) {
33122 int32x4_t __ret;
33123 __ret = (int32x4_t)(__p0);
33124 return __ret;
33125}
33126__ai int32x4_t vreinterpretq_s32_u8(uint8x16_t __p0) {
33127 int32x4_t __ret;
33128 __ret = (int32x4_t)(__p0);
33129 return __ret;
33130}
33131__ai int32x4_t vreinterpretq_s32_u32(uint32x4_t __p0) {
33132 int32x4_t __ret;
33133 __ret = (int32x4_t)(__p0);
33134 return __ret;
33135}
33136__ai int32x4_t vreinterpretq_s32_u64(uint64x2_t __p0) {
33137 int32x4_t __ret;
33138 __ret = (int32x4_t)(__p0);
33139 return __ret;
33140}
33141__ai int32x4_t vreinterpretq_s32_u16(uint16x8_t __p0) {
33142 int32x4_t __ret;
33143 __ret = (int32x4_t)(__p0);
32875#endif
32876
32877#ifdef __LITTLE_ENDIAN__
32878#define vld1q_bf16(__p0) __extension__ ({ \
32879 bfloat16x8_t __ret; \
32880 __ret = (bfloat16x8_t) __builtin_neon_vld1q_bf16(__p0, 43); \
32881 __ret; \
32882})
32883#else
32884#define vld1q_bf16(__p0) __extension__ ({ \
32885 bfloat16x8_t __ret; \
32886 __ret = (bfloat16x8_t) __builtin_neon_vld1q_bf16(__p0, 43); \
32887 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
32888 __ret; \
32889})
32890#endif
32891
32892#ifdef __LITTLE_ENDIAN__
32893#define vld1_bf16(__p0) __extension__ ({ \
32894 bfloat16x4_t __ret; \
32895 __ret = (bfloat16x4_t) __builtin_neon_vld1_bf16(__p0, 11); \
32896 __ret; \
32897})
32898#else
32899#define vld1_bf16(__p0) __extension__ ({ \
32900 bfloat16x4_t __ret; \
32901 __ret = (bfloat16x4_t) __builtin_neon_vld1_bf16(__p0, 11); \
32902 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
32903 __ret; \
32904})
32905#endif
32906
32907#ifdef __LITTLE_ENDIAN__
32908#define vld1q_dup_bf16(__p0) __extension__ ({ \
32909 bfloat16x8_t __ret; \
32910 __ret = (bfloat16x8_t) __builtin_neon_vld1q_dup_bf16(__p0, 43); \
32911 __ret; \
32912})
32913#else
32914#define vld1q_dup_bf16(__p0) __extension__ ({ \
32915 bfloat16x8_t __ret; \
32916 __ret = (bfloat16x8_t) __builtin_neon_vld1q_dup_bf16(__p0, 43); \
32917 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
32918 __ret; \
32919})
32920#endif
32921
32922#ifdef __LITTLE_ENDIAN__
32923#define vld1_dup_bf16(__p0) __extension__ ({ \
32924 bfloat16x4_t __ret; \
32925 __ret = (bfloat16x4_t) __builtin_neon_vld1_dup_bf16(__p0, 11); \
32926 __ret; \
32927})
32928#else
32929#define vld1_dup_bf16(__p0) __extension__ ({ \
32930 bfloat16x4_t __ret; \
32931 __ret = (bfloat16x4_t) __builtin_neon_vld1_dup_bf16(__p0, 11); \
32932 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
32933 __ret; \
32934})
32935#endif
32936
32937#ifdef __LITTLE_ENDIAN__
32938#define vld1q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
32939 bfloat16x8_t __ret; \
32940 bfloat16x8_t __s1 = __p1; \
32941 __ret = (bfloat16x8_t) __builtin_neon_vld1q_lane_bf16(__p0, (int8x16_t)__s1, __p2, 43); \
32942 __ret; \
32943})
32944#else
32945#define vld1q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
32946 bfloat16x8_t __ret; \
32947 bfloat16x8_t __s1 = __p1; \
32948 bfloat16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
32949 __ret = (bfloat16x8_t) __builtin_neon_vld1q_lane_bf16(__p0, (int8x16_t)__rev1, __p2, 43); \
32950 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
32951 __ret; \
32952})
32953#endif
32954
32955#ifdef __LITTLE_ENDIAN__
32956#define vld1_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
32957 bfloat16x4_t __ret; \
32958 bfloat16x4_t __s1 = __p1; \
32959 __ret = (bfloat16x4_t) __builtin_neon_vld1_lane_bf16(__p0, (int8x8_t)__s1, __p2, 11); \
32960 __ret; \
32961})
32962#else
32963#define vld1_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
32964 bfloat16x4_t __ret; \
32965 bfloat16x4_t __s1 = __p1; \
32966 bfloat16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
32967 __ret = (bfloat16x4_t) __builtin_neon_vld1_lane_bf16(__p0, (int8x8_t)__rev1, __p2, 11); \
32968 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
32969 __ret; \
32970})
32971#endif
32972
32973#ifdef __LITTLE_ENDIAN__
32974#define vld1q_bf16_x2(__p0) __extension__ ({ \
32975 bfloat16x8x2_t __ret; \
32976 __builtin_neon_vld1q_bf16_x2(&__ret, __p0, 43); \
32977 __ret; \
32978})
32979#else
32980#define vld1q_bf16_x2(__p0) __extension__ ({ \
32981 bfloat16x8x2_t __ret; \
32982 __builtin_neon_vld1q_bf16_x2(&__ret, __p0, 43); \
32983 \
32984 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
32985 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
32986 __ret; \
32987})
32988#endif
32989
32990#ifdef __LITTLE_ENDIAN__
32991#define vld1_bf16_x2(__p0) __extension__ ({ \
32992 bfloat16x4x2_t __ret; \
32993 __builtin_neon_vld1_bf16_x2(&__ret, __p0, 11); \
32994 __ret; \
32995})
32996#else
32997#define vld1_bf16_x2(__p0) __extension__ ({ \
32998 bfloat16x4x2_t __ret; \
32999 __builtin_neon_vld1_bf16_x2(&__ret, __p0, 11); \
33000 \
33001 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
33002 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
33003 __ret; \
33004})
33005#endif
33006
33007#ifdef __LITTLE_ENDIAN__
33008#define vld1q_bf16_x3(__p0) __extension__ ({ \
33009 bfloat16x8x3_t __ret; \
33010 __builtin_neon_vld1q_bf16_x3(&__ret, __p0, 43); \
33011 __ret; \
33012})
33013#else
33014#define vld1q_bf16_x3(__p0) __extension__ ({ \
33015 bfloat16x8x3_t __ret; \
33016 __builtin_neon_vld1q_bf16_x3(&__ret, __p0, 43); \
33017 \
33018 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
33019 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
33020 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
33021 __ret; \
33022})
33023#endif
33024
33025#ifdef __LITTLE_ENDIAN__
33026#define vld1_bf16_x3(__p0) __extension__ ({ \
33027 bfloat16x4x3_t __ret; \
33028 __builtin_neon_vld1_bf16_x3(&__ret, __p0, 11); \
33029 __ret; \
33030})
33031#else
33032#define vld1_bf16_x3(__p0) __extension__ ({ \
33033 bfloat16x4x3_t __ret; \
33034 __builtin_neon_vld1_bf16_x3(&__ret, __p0, 11); \
33035 \
33036 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
33037 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
33038 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
33039 __ret; \
33040})
33041#endif
33042
33043#ifdef __LITTLE_ENDIAN__
33044#define vld1q_bf16_x4(__p0) __extension__ ({ \
33045 bfloat16x8x4_t __ret; \
33046 __builtin_neon_vld1q_bf16_x4(&__ret, __p0, 43); \
33047 __ret; \
33048})
33049#else
33050#define vld1q_bf16_x4(__p0) __extension__ ({ \
33051 bfloat16x8x4_t __ret; \
33052 __builtin_neon_vld1q_bf16_x4(&__ret, __p0, 43); \
33053 \
33054 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
33055 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
33056 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
33057 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
33058 __ret; \
33059})
33060#endif
33061
33062#ifdef __LITTLE_ENDIAN__
33063#define vld1_bf16_x4(__p0) __extension__ ({ \
33064 bfloat16x4x4_t __ret; \
33065 __builtin_neon_vld1_bf16_x4(&__ret, __p0, 11); \
33066 __ret; \
33067})
33068#else
33069#define vld1_bf16_x4(__p0) __extension__ ({ \
33070 bfloat16x4x4_t __ret; \
33071 __builtin_neon_vld1_bf16_x4(&__ret, __p0, 11); \
33072 \
33073 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
33074 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
33075 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
33076 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 3, 2, 1, 0); \
33077 __ret; \
33078})
33079#endif
33080
33081#ifdef __LITTLE_ENDIAN__
33082#define vld2q_bf16(__p0) __extension__ ({ \
33083 bfloat16x8x2_t __ret; \
33084 __builtin_neon_vld2q_bf16(&__ret, __p0, 43); \
33085 __ret; \
33086})
33087#else
33088#define vld2q_bf16(__p0) __extension__ ({ \
33089 bfloat16x8x2_t __ret; \
33090 __builtin_neon_vld2q_bf16(&__ret, __p0, 43); \
33091 \
33092 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
33093 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
33094 __ret; \
33095})
33096#endif
33097
33098#ifdef __LITTLE_ENDIAN__
33099#define vld2_bf16(__p0) __extension__ ({ \
33100 bfloat16x4x2_t __ret; \
33101 __builtin_neon_vld2_bf16(&__ret, __p0, 11); \
33102 __ret; \
33103})
33104#else
33105#define vld2_bf16(__p0) __extension__ ({ \
33106 bfloat16x4x2_t __ret; \
33107 __builtin_neon_vld2_bf16(&__ret, __p0, 11); \
33108 \
33109 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
33110 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
33111 __ret; \
33112})
33113#endif
33114
33115#ifdef __LITTLE_ENDIAN__
33116#define vld2q_dup_bf16(__p0) __extension__ ({ \
33117 bfloat16x8x2_t __ret; \
33118 __builtin_neon_vld2q_dup_bf16(&__ret, __p0, 43); \
33119 __ret; \
33120})
33121#else
33122#define vld2q_dup_bf16(__p0) __extension__ ({ \
33123 bfloat16x8x2_t __ret; \
33124 __builtin_neon_vld2q_dup_bf16(&__ret, __p0, 43); \
33125 \
33126 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
33127 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
33128 __ret; \
33129})
33130#endif
33131
33132#ifdef __LITTLE_ENDIAN__
33133#define vld2_dup_bf16(__p0) __extension__ ({ \
33134 bfloat16x4x2_t __ret; \
33135 __builtin_neon_vld2_dup_bf16(&__ret, __p0, 11); \
33136 __ret; \
33137})
33138#else
33139#define vld2_dup_bf16(__p0) __extension__ ({ \
33140 bfloat16x4x2_t __ret; \
33141 __builtin_neon_vld2_dup_bf16(&__ret, __p0, 11); \
33142 \
33143 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
33144 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
33145 __ret; \
33146})
33147#endif
33148
33149#ifdef __LITTLE_ENDIAN__
33150#define vld2q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33151 bfloat16x8x2_t __ret; \
33152 bfloat16x8x2_t __s1 = __p1; \
33153 __builtin_neon_vld2q_lane_bf16(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 43); \
33154 __ret; \
33155})
33156#else
33157#define vld2q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33158 bfloat16x8x2_t __ret; \
33159 bfloat16x8x2_t __s1 = __p1; \
33160 bfloat16x8x2_t __rev1; \
33161 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
33162 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
33163 __builtin_neon_vld2q_lane_bf16(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 43); \
33164 \
33165 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
33166 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
33167 __ret; \
33168})
33169#endif
33170
33171#ifdef __LITTLE_ENDIAN__
33172#define vld2_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33173 bfloat16x4x2_t __ret; \
33174 bfloat16x4x2_t __s1 = __p1; \
33175 __builtin_neon_vld2_lane_bf16(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], __p2, 11); \
33176 __ret; \
33177})
33178#else
33179#define vld2_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33180 bfloat16x4x2_t __ret; \
33181 bfloat16x4x2_t __s1 = __p1; \
33182 bfloat16x4x2_t __rev1; \
33183 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
33184 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
33185 __builtin_neon_vld2_lane_bf16(&__ret, __p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], __p2, 11); \
33186 \
33187 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
33188 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
33189 __ret; \
33190})
33191#endif
33192
33193#ifdef __LITTLE_ENDIAN__
33194#define vld3q_bf16(__p0) __extension__ ({ \
33195 bfloat16x8x3_t __ret; \
33196 __builtin_neon_vld3q_bf16(&__ret, __p0, 43); \
33197 __ret; \
33198})
33199#else
33200#define vld3q_bf16(__p0) __extension__ ({ \
33201 bfloat16x8x3_t __ret; \
33202 __builtin_neon_vld3q_bf16(&__ret, __p0, 43); \
33203 \
33204 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
33205 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
33206 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
33207 __ret; \
33208})
33209#endif
33210
33211#ifdef __LITTLE_ENDIAN__
33212#define vld3_bf16(__p0) __extension__ ({ \
33213 bfloat16x4x3_t __ret; \
33214 __builtin_neon_vld3_bf16(&__ret, __p0, 11); \
33215 __ret; \
33216})
33217#else
33218#define vld3_bf16(__p0) __extension__ ({ \
33219 bfloat16x4x3_t __ret; \
33220 __builtin_neon_vld3_bf16(&__ret, __p0, 11); \
33221 \
33222 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
33223 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
33224 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
33225 __ret; \
33226})
33227#endif
33228
33229#ifdef __LITTLE_ENDIAN__
33230#define vld3q_dup_bf16(__p0) __extension__ ({ \
33231 bfloat16x8x3_t __ret; \
33232 __builtin_neon_vld3q_dup_bf16(&__ret, __p0, 43); \
33233 __ret; \
33234})
33235#else
33236#define vld3q_dup_bf16(__p0) __extension__ ({ \
33237 bfloat16x8x3_t __ret; \
33238 __builtin_neon_vld3q_dup_bf16(&__ret, __p0, 43); \
33239 \
33240 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
33241 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
33242 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
33243 __ret; \
33244})
33245#endif
33246
33247#ifdef __LITTLE_ENDIAN__
33248#define vld3_dup_bf16(__p0) __extension__ ({ \
33249 bfloat16x4x3_t __ret; \
33250 __builtin_neon_vld3_dup_bf16(&__ret, __p0, 11); \
33251 __ret; \
33252})
33253#else
33254#define vld3_dup_bf16(__p0) __extension__ ({ \
33255 bfloat16x4x3_t __ret; \
33256 __builtin_neon_vld3_dup_bf16(&__ret, __p0, 11); \
33257 \
33258 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
33259 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
33260 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
33261 __ret; \
33262})
33263#endif
33264
33265#ifdef __LITTLE_ENDIAN__
33266#define vld3q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33267 bfloat16x8x3_t __ret; \
33268 bfloat16x8x3_t __s1 = __p1; \
33269 __builtin_neon_vld3q_lane_bf16(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 43); \
33270 __ret; \
33271})
33272#else
33273#define vld3q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33274 bfloat16x8x3_t __ret; \
33275 bfloat16x8x3_t __s1 = __p1; \
33276 bfloat16x8x3_t __rev1; \
33277 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
33278 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
33279 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
33280 __builtin_neon_vld3q_lane_bf16(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 43); \
33281 \
33282 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
33283 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
33284 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
33285 __ret; \
33286})
33287#endif
33288
33289#ifdef __LITTLE_ENDIAN__
33290#define vld3_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33291 bfloat16x4x3_t __ret; \
33292 bfloat16x4x3_t __s1 = __p1; \
33293 __builtin_neon_vld3_lane_bf16(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], __p2, 11); \
33294 __ret; \
33295})
33296#else
33297#define vld3_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33298 bfloat16x4x3_t __ret; \
33299 bfloat16x4x3_t __s1 = __p1; \
33300 bfloat16x4x3_t __rev1; \
33301 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
33302 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
33303 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
33304 __builtin_neon_vld3_lane_bf16(&__ret, __p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], __p2, 11); \
33305 \
33306 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
33307 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
33308 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
33309 __ret; \
33310})
33311#endif
33312
33313#ifdef __LITTLE_ENDIAN__
33314#define vld4q_bf16(__p0) __extension__ ({ \
33315 bfloat16x8x4_t __ret; \
33316 __builtin_neon_vld4q_bf16(&__ret, __p0, 43); \
33317 __ret; \
33318})
33319#else
33320#define vld4q_bf16(__p0) __extension__ ({ \
33321 bfloat16x8x4_t __ret; \
33322 __builtin_neon_vld4q_bf16(&__ret, __p0, 43); \
33323 \
33324 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
33325 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
33326 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
33327 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
33328 __ret; \
33329})
33330#endif
33331
33332#ifdef __LITTLE_ENDIAN__
33333#define vld4_bf16(__p0) __extension__ ({ \
33334 bfloat16x4x4_t __ret; \
33335 __builtin_neon_vld4_bf16(&__ret, __p0, 11); \
33336 __ret; \
33337})
33338#else
33339#define vld4_bf16(__p0) __extension__ ({ \
33340 bfloat16x4x4_t __ret; \
33341 __builtin_neon_vld4_bf16(&__ret, __p0, 11); \
33342 \
33343 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
33344 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
33345 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
33346 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 3, 2, 1, 0); \
33347 __ret; \
33348})
33349#endif
33350
33351#ifdef __LITTLE_ENDIAN__
33352#define vld4q_dup_bf16(__p0) __extension__ ({ \
33353 bfloat16x8x4_t __ret; \
33354 __builtin_neon_vld4q_dup_bf16(&__ret, __p0, 43); \
33355 __ret; \
33356})
33357#else
33358#define vld4q_dup_bf16(__p0) __extension__ ({ \
33359 bfloat16x8x4_t __ret; \
33360 __builtin_neon_vld4q_dup_bf16(&__ret, __p0, 43); \
33361 \
33362 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
33363 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
33364 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
33365 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
33366 __ret; \
33367})
33368#endif
33369
33370#ifdef __LITTLE_ENDIAN__
33371#define vld4_dup_bf16(__p0) __extension__ ({ \
33372 bfloat16x4x4_t __ret; \
33373 __builtin_neon_vld4_dup_bf16(&__ret, __p0, 11); \
33374 __ret; \
33375})
33376#else
33377#define vld4_dup_bf16(__p0) __extension__ ({ \
33378 bfloat16x4x4_t __ret; \
33379 __builtin_neon_vld4_dup_bf16(&__ret, __p0, 11); \
33380 \
33381 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
33382 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
33383 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
33384 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 3, 2, 1, 0); \
33385 __ret; \
33386})
33387#endif
33388
33389#ifdef __LITTLE_ENDIAN__
33390#define vld4q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33391 bfloat16x8x4_t __ret; \
33392 bfloat16x8x4_t __s1 = __p1; \
33393 __builtin_neon_vld4q_lane_bf16(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 43); \
33394 __ret; \
33395})
33396#else
33397#define vld4q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33398 bfloat16x8x4_t __ret; \
33399 bfloat16x8x4_t __s1 = __p1; \
33400 bfloat16x8x4_t __rev1; \
33401 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
33402 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
33403 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
33404 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
33405 __builtin_neon_vld4q_lane_bf16(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 43); \
33406 \
33407 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
33408 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
33409 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
33410 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
33411 __ret; \
33412})
33413#endif
33414
33415#ifdef __LITTLE_ENDIAN__
33416#define vld4_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33417 bfloat16x4x4_t __ret; \
33418 bfloat16x4x4_t __s1 = __p1; \
33419 __builtin_neon_vld4_lane_bf16(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], __p2, 11); \
33420 __ret; \
33421})
33422#else
33423#define vld4_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33424 bfloat16x4x4_t __ret; \
33425 bfloat16x4x4_t __s1 = __p1; \
33426 bfloat16x4x4_t __rev1; \
33427 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
33428 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
33429 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
33430 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 3, 2, 1, 0); \
33431 __builtin_neon_vld4_lane_bf16(&__ret, __p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], (int8x8_t)__rev1.val[3], __p2, 11); \
33432 \
33433 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
33434 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
33435 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
33436 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 3, 2, 1, 0); \
33437 __ret; \
33438})
33439#endif
33440
33441#ifdef __LITTLE_ENDIAN__
33442#define vsetq_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33443 bfloat16x8_t __ret; \
33444 bfloat16_t __s0 = __p0; \
33445 bfloat16x8_t __s1 = __p1; \
33446 __ret = (bfloat16x8_t) __builtin_neon_vsetq_lane_bf16(__s0, (bfloat16x8_t)__s1, __p2); \
33447 __ret; \
33448})
33449#else
33450#define vsetq_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33451 bfloat16x8_t __ret; \
33452 bfloat16_t __s0 = __p0; \
33453 bfloat16x8_t __s1 = __p1; \
33454 bfloat16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
33455 __ret = (bfloat16x8_t) __builtin_neon_vsetq_lane_bf16(__s0, (bfloat16x8_t)__rev1, __p2); \
33456 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
33457 __ret; \
33458})
33459#define __noswap_vsetq_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33460 bfloat16x8_t __ret; \
33461 bfloat16_t __s0 = __p0; \
33462 bfloat16x8_t __s1 = __p1; \
33463 __ret = (bfloat16x8_t) __builtin_neon_vsetq_lane_bf16(__s0, (bfloat16x8_t)__s1, __p2); \
33464 __ret; \
33465})
33466#endif
33467
33468#ifdef __LITTLE_ENDIAN__
33469#define vset_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33470 bfloat16x4_t __ret; \
33471 bfloat16_t __s0 = __p0; \
33472 bfloat16x4_t __s1 = __p1; \
33473 __ret = (bfloat16x4_t) __builtin_neon_vset_lane_bf16(__s0, (bfloat16x4_t)__s1, __p2); \
33474 __ret; \
33475})
33476#else
33477#define vset_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33478 bfloat16x4_t __ret; \
33479 bfloat16_t __s0 = __p0; \
33480 bfloat16x4_t __s1 = __p1; \
33481 bfloat16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
33482 __ret = (bfloat16x4_t) __builtin_neon_vset_lane_bf16(__s0, (bfloat16x4_t)__rev1, __p2); \
33483 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
33484 __ret; \
33485})
33486#define __noswap_vset_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33487 bfloat16x4_t __ret; \
33488 bfloat16_t __s0 = __p0; \
33489 bfloat16x4_t __s1 = __p1; \
33490 __ret = (bfloat16x4_t) __builtin_neon_vset_lane_bf16(__s0, (bfloat16x4_t)__s1, __p2); \
33491 __ret; \
33492})
33493#endif
33494
33495#ifdef __LITTLE_ENDIAN__
33496#define vst1q_bf16(__p0, __p1) __extension__ ({ \
33497 bfloat16x8_t __s1 = __p1; \
33498 __builtin_neon_vst1q_bf16(__p0, (int8x16_t)__s1, 43); \
33499})
33500#else
33501#define vst1q_bf16(__p0, __p1) __extension__ ({ \
33502 bfloat16x8_t __s1 = __p1; \
33503 bfloat16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
33504 __builtin_neon_vst1q_bf16(__p0, (int8x16_t)__rev1, 43); \
33505})
33506#endif
33507
33508#ifdef __LITTLE_ENDIAN__
33509#define vst1_bf16(__p0, __p1) __extension__ ({ \
33510 bfloat16x4_t __s1 = __p1; \
33511 __builtin_neon_vst1_bf16(__p0, (int8x8_t)__s1, 11); \
33512})
33513#else
33514#define vst1_bf16(__p0, __p1) __extension__ ({ \
33515 bfloat16x4_t __s1 = __p1; \
33516 bfloat16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
33517 __builtin_neon_vst1_bf16(__p0, (int8x8_t)__rev1, 11); \
33518})
33519#endif
33520
33521#ifdef __LITTLE_ENDIAN__
33522#define vst1q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33523 bfloat16x8_t __s1 = __p1; \
33524 __builtin_neon_vst1q_lane_bf16(__p0, (int8x16_t)__s1, __p2, 43); \
33525})
33526#else
33527#define vst1q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33528 bfloat16x8_t __s1 = __p1; \
33529 bfloat16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
33530 __builtin_neon_vst1q_lane_bf16(__p0, (int8x16_t)__rev1, __p2, 43); \
33531})
33532#endif
33533
33534#ifdef __LITTLE_ENDIAN__
33535#define vst1_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33536 bfloat16x4_t __s1 = __p1; \
33537 __builtin_neon_vst1_lane_bf16(__p0, (int8x8_t)__s1, __p2, 11); \
33538})
33539#else
33540#define vst1_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33541 bfloat16x4_t __s1 = __p1; \
33542 bfloat16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
33543 __builtin_neon_vst1_lane_bf16(__p0, (int8x8_t)__rev1, __p2, 11); \
33544})
33545#endif
33546
33547#ifdef __LITTLE_ENDIAN__
33548#define vst1q_bf16_x2(__p0, __p1) __extension__ ({ \
33549 bfloat16x8x2_t __s1 = __p1; \
33550 __builtin_neon_vst1q_bf16_x2(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], 43); \
33551})
33552#else
33553#define vst1q_bf16_x2(__p0, __p1) __extension__ ({ \
33554 bfloat16x8x2_t __s1 = __p1; \
33555 bfloat16x8x2_t __rev1; \
33556 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
33557 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
33558 __builtin_neon_vst1q_bf16_x2(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], 43); \
33559})
33560#endif
33561
33562#ifdef __LITTLE_ENDIAN__
33563#define vst1_bf16_x2(__p0, __p1) __extension__ ({ \
33564 bfloat16x4x2_t __s1 = __p1; \
33565 __builtin_neon_vst1_bf16_x2(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], 11); \
33566})
33567#else
33568#define vst1_bf16_x2(__p0, __p1) __extension__ ({ \
33569 bfloat16x4x2_t __s1 = __p1; \
33570 bfloat16x4x2_t __rev1; \
33571 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
33572 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
33573 __builtin_neon_vst1_bf16_x2(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], 11); \
33574})
33575#endif
33576
33577#ifdef __LITTLE_ENDIAN__
33578#define vst1q_bf16_x3(__p0, __p1) __extension__ ({ \
33579 bfloat16x8x3_t __s1 = __p1; \
33580 __builtin_neon_vst1q_bf16_x3(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], 43); \
33581})
33582#else
33583#define vst1q_bf16_x3(__p0, __p1) __extension__ ({ \
33584 bfloat16x8x3_t __s1 = __p1; \
33585 bfloat16x8x3_t __rev1; \
33586 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
33587 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
33588 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
33589 __builtin_neon_vst1q_bf16_x3(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], 43); \
33590})
33591#endif
33592
33593#ifdef __LITTLE_ENDIAN__
33594#define vst1_bf16_x3(__p0, __p1) __extension__ ({ \
33595 bfloat16x4x3_t __s1 = __p1; \
33596 __builtin_neon_vst1_bf16_x3(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], 11); \
33597})
33598#else
33599#define vst1_bf16_x3(__p0, __p1) __extension__ ({ \
33600 bfloat16x4x3_t __s1 = __p1; \
33601 bfloat16x4x3_t __rev1; \
33602 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
33603 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
33604 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
33605 __builtin_neon_vst1_bf16_x3(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], 11); \
33606})
33607#endif
33608
33609#ifdef __LITTLE_ENDIAN__
33610#define vst1q_bf16_x4(__p0, __p1) __extension__ ({ \
33611 bfloat16x8x4_t __s1 = __p1; \
33612 __builtin_neon_vst1q_bf16_x4(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], 43); \
33613})
33614#else
33615#define vst1q_bf16_x4(__p0, __p1) __extension__ ({ \
33616 bfloat16x8x4_t __s1 = __p1; \
33617 bfloat16x8x4_t __rev1; \
33618 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
33619 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
33620 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
33621 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
33622 __builtin_neon_vst1q_bf16_x4(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], 43); \
33623})
33624#endif
33625
33626#ifdef __LITTLE_ENDIAN__
33627#define vst1_bf16_x4(__p0, __p1) __extension__ ({ \
33628 bfloat16x4x4_t __s1 = __p1; \
33629 __builtin_neon_vst1_bf16_x4(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], 11); \
33630})
33631#else
33632#define vst1_bf16_x4(__p0, __p1) __extension__ ({ \
33633 bfloat16x4x4_t __s1 = __p1; \
33634 bfloat16x4x4_t __rev1; \
33635 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
33636 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
33637 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
33638 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 3, 2, 1, 0); \
33639 __builtin_neon_vst1_bf16_x4(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], (int8x8_t)__rev1.val[3], 11); \
33640})
33641#endif
33642
33643#ifdef __LITTLE_ENDIAN__
33644#define vst2q_bf16(__p0, __p1) __extension__ ({ \
33645 bfloat16x8x2_t __s1 = __p1; \
33646 __builtin_neon_vst2q_bf16(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], 43); \
33647})
33648#else
33649#define vst2q_bf16(__p0, __p1) __extension__ ({ \
33650 bfloat16x8x2_t __s1 = __p1; \
33651 bfloat16x8x2_t __rev1; \
33652 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
33653 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
33654 __builtin_neon_vst2q_bf16(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], 43); \
33655})
33656#endif
33657
33658#ifdef __LITTLE_ENDIAN__
33659#define vst2_bf16(__p0, __p1) __extension__ ({ \
33660 bfloat16x4x2_t __s1 = __p1; \
33661 __builtin_neon_vst2_bf16(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], 11); \
33662})
33663#else
33664#define vst2_bf16(__p0, __p1) __extension__ ({ \
33665 bfloat16x4x2_t __s1 = __p1; \
33666 bfloat16x4x2_t __rev1; \
33667 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
33668 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
33669 __builtin_neon_vst2_bf16(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], 11); \
33670})
33671#endif
33672
33673#ifdef __LITTLE_ENDIAN__
33674#define vst2q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33675 bfloat16x8x2_t __s1 = __p1; \
33676 __builtin_neon_vst2q_lane_bf16(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 43); \
33677})
33678#else
33679#define vst2q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33680 bfloat16x8x2_t __s1 = __p1; \
33681 bfloat16x8x2_t __rev1; \
33682 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
33683 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
33684 __builtin_neon_vst2q_lane_bf16(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 43); \
33685})
33686#endif
33687
33688#ifdef __LITTLE_ENDIAN__
33689#define vst2_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33690 bfloat16x4x2_t __s1 = __p1; \
33691 __builtin_neon_vst2_lane_bf16(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], __p2, 11); \
33692})
33693#else
33694#define vst2_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33695 bfloat16x4x2_t __s1 = __p1; \
33696 bfloat16x4x2_t __rev1; \
33697 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
33698 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
33699 __builtin_neon_vst2_lane_bf16(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], __p2, 11); \
33700})
33701#endif
33702
33703#ifdef __LITTLE_ENDIAN__
33704#define vst3q_bf16(__p0, __p1) __extension__ ({ \
33705 bfloat16x8x3_t __s1 = __p1; \
33706 __builtin_neon_vst3q_bf16(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], 43); \
33707})
33708#else
33709#define vst3q_bf16(__p0, __p1) __extension__ ({ \
33710 bfloat16x8x3_t __s1 = __p1; \
33711 bfloat16x8x3_t __rev1; \
33712 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
33713 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
33714 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
33715 __builtin_neon_vst3q_bf16(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], 43); \
33716})
33717#endif
33718
33719#ifdef __LITTLE_ENDIAN__
33720#define vst3_bf16(__p0, __p1) __extension__ ({ \
33721 bfloat16x4x3_t __s1 = __p1; \
33722 __builtin_neon_vst3_bf16(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], 11); \
33723})
33724#else
33725#define vst3_bf16(__p0, __p1) __extension__ ({ \
33726 bfloat16x4x3_t __s1 = __p1; \
33727 bfloat16x4x3_t __rev1; \
33728 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
33729 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
33730 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
33731 __builtin_neon_vst3_bf16(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], 11); \
33732})
33733#endif
33734
33735#ifdef __LITTLE_ENDIAN__
33736#define vst3q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33737 bfloat16x8x3_t __s1 = __p1; \
33738 __builtin_neon_vst3q_lane_bf16(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 43); \
33739})
33740#else
33741#define vst3q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33742 bfloat16x8x3_t __s1 = __p1; \
33743 bfloat16x8x3_t __rev1; \
33744 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
33745 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
33746 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
33747 __builtin_neon_vst3q_lane_bf16(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 43); \
33748})
33749#endif
33750
33751#ifdef __LITTLE_ENDIAN__
33752#define vst3_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33753 bfloat16x4x3_t __s1 = __p1; \
33754 __builtin_neon_vst3_lane_bf16(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], __p2, 11); \
33755})
33756#else
33757#define vst3_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33758 bfloat16x4x3_t __s1 = __p1; \
33759 bfloat16x4x3_t __rev1; \
33760 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
33761 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
33762 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
33763 __builtin_neon_vst3_lane_bf16(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], __p2, 11); \
33764})
33765#endif
33766
33767#ifdef __LITTLE_ENDIAN__
33768#define vst4q_bf16(__p0, __p1) __extension__ ({ \
33769 bfloat16x8x4_t __s1 = __p1; \
33770 __builtin_neon_vst4q_bf16(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], 43); \
33771})
33772#else
33773#define vst4q_bf16(__p0, __p1) __extension__ ({ \
33774 bfloat16x8x4_t __s1 = __p1; \
33775 bfloat16x8x4_t __rev1; \
33776 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
33777 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
33778 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
33779 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
33780 __builtin_neon_vst4q_bf16(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], 43); \
33781})
33782#endif
33783
33784#ifdef __LITTLE_ENDIAN__
33785#define vst4_bf16(__p0, __p1) __extension__ ({ \
33786 bfloat16x4x4_t __s1 = __p1; \
33787 __builtin_neon_vst4_bf16(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], 11); \
33788})
33789#else
33790#define vst4_bf16(__p0, __p1) __extension__ ({ \
33791 bfloat16x4x4_t __s1 = __p1; \
33792 bfloat16x4x4_t __rev1; \
33793 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
33794 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
33795 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
33796 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 3, 2, 1, 0); \
33797 __builtin_neon_vst4_bf16(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], (int8x8_t)__rev1.val[3], 11); \
33798})
33799#endif
33800
33801#ifdef __LITTLE_ENDIAN__
33802#define vst4q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33803 bfloat16x8x4_t __s1 = __p1; \
33804 __builtin_neon_vst4q_lane_bf16(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 43); \
33805})
33806#else
33807#define vst4q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33808 bfloat16x8x4_t __s1 = __p1; \
33809 bfloat16x8x4_t __rev1; \
33810 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
33811 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
33812 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
33813 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
33814 __builtin_neon_vst4q_lane_bf16(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 43); \
33815})
33816#endif
33817
33818#ifdef __LITTLE_ENDIAN__
33819#define vst4_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33820 bfloat16x4x4_t __s1 = __p1; \
33821 __builtin_neon_vst4_lane_bf16(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], __p2, 11); \
33822})
33823#else
33824#define vst4_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
33825 bfloat16x4x4_t __s1 = __p1; \
33826 bfloat16x4x4_t __rev1; \
33827 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
33828 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
33829 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
33830 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 3, 2, 1, 0); \
33831 __builtin_neon_vst4_lane_bf16(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], (int8x8_t)__rev1.val[3], __p2, 11); \
33832})
33833#endif
33834
33835#ifdef __LITTLE_ENDIAN__
33836__ai __attribute__((target("dotprod"))) uint32x4_t vdotq_u32(uint32x4_t __p0, uint8x16_t __p1, uint8x16_t __p2) {
33837 uint32x4_t __ret;
33838 __ret = (uint32x4_t) __builtin_neon_vdotq_u32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 50);
3314433839 return __ret;
3314533840}
33146__ai int32x4_t vreinterpretq_s32_s8(int8x16_t __p0) {
33147 int32x4_t __ret;
33148 __ret = (int32x4_t)(__p0);
33841#else
33842__ai __attribute__((target("dotprod"))) uint32x4_t vdotq_u32(uint32x4_t __p0, uint8x16_t __p1, uint8x16_t __p2) {
33843 uint32x4_t __ret;
33844 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
33845 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
33846 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
33847 __ret = (uint32x4_t) __builtin_neon_vdotq_u32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 50);
33848 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3314933849 return __ret;
3315033850}
33151__ai int32x4_t vreinterpretq_s32_f32(float32x4_t __p0) {
33152 int32x4_t __ret;
33153 __ret = (int32x4_t)(__p0);
33851__ai __attribute__((target("dotprod"))) uint32x4_t __noswap_vdotq_u32(uint32x4_t __p0, uint8x16_t __p1, uint8x16_t __p2) {
33852 uint32x4_t __ret;
33853 __ret = (uint32x4_t) __builtin_neon_vdotq_u32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 50);
3315433854 return __ret;
3315533855}
33156__ai int32x4_t vreinterpretq_s32_f16(float16x8_t __p0) {
33856#endif
33857
33858#ifdef __LITTLE_ENDIAN__
33859__ai __attribute__((target("dotprod"))) int32x4_t vdotq_s32(int32x4_t __p0, int8x16_t __p1, int8x16_t __p2) {
3315733860 int32x4_t __ret;
33158 __ret = (int32x4_t)(__p0);
33861 __ret = (int32x4_t) __builtin_neon_vdotq_s32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 34);
3315933862 return __ret;
3316033863}
33161__ai int32x4_t vreinterpretq_s32_s64(int64x2_t __p0) {
33864#else
33865__ai __attribute__((target("dotprod"))) int32x4_t vdotq_s32(int32x4_t __p0, int8x16_t __p1, int8x16_t __p2) {
3316233866 int32x4_t __ret;
33163 __ret = (int32x4_t)(__p0);
33867 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
33868 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
33869 int8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
33870 __ret = (int32x4_t) __builtin_neon_vdotq_s32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 34);
33871 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3316433872 return __ret;
3316533873}
33166__ai int32x4_t vreinterpretq_s32_s16(int16x8_t __p0) {
33874__ai __attribute__((target("dotprod"))) int32x4_t __noswap_vdotq_s32(int32x4_t __p0, int8x16_t __p1, int8x16_t __p2) {
3316733875 int32x4_t __ret;
33168 __ret = (int32x4_t)(__p0);
33169 return __ret;
33170}
33171__ai int64x2_t vreinterpretq_s64_p8(poly8x16_t __p0) {
33172 int64x2_t __ret;
33173 __ret = (int64x2_t)(__p0);
33174 return __ret;
33175}
33176__ai int64x2_t vreinterpretq_s64_p16(poly16x8_t __p0) {
33177 int64x2_t __ret;
33178 __ret = (int64x2_t)(__p0);
33179 return __ret;
33180}
33181__ai int64x2_t vreinterpretq_s64_u8(uint8x16_t __p0) {
33182 int64x2_t __ret;
33183 __ret = (int64x2_t)(__p0);
33184 return __ret;
33185}
33186__ai int64x2_t vreinterpretq_s64_u32(uint32x4_t __p0) {
33187 int64x2_t __ret;
33188 __ret = (int64x2_t)(__p0);
33189 return __ret;
33190}
33191__ai int64x2_t vreinterpretq_s64_u64(uint64x2_t __p0) {
33192 int64x2_t __ret;
33193 __ret = (int64x2_t)(__p0);
33194 return __ret;
33195}
33196__ai int64x2_t vreinterpretq_s64_u16(uint16x8_t __p0) {
33197 int64x2_t __ret;
33198 __ret = (int64x2_t)(__p0);
33199 return __ret;
33200}
33201__ai int64x2_t vreinterpretq_s64_s8(int8x16_t __p0) {
33202 int64x2_t __ret;
33203 __ret = (int64x2_t)(__p0);
33204 return __ret;
33205}
33206__ai int64x2_t vreinterpretq_s64_f32(float32x4_t __p0) {
33207 int64x2_t __ret;
33208 __ret = (int64x2_t)(__p0);
33209 return __ret;
33210}
33211__ai int64x2_t vreinterpretq_s64_f16(float16x8_t __p0) {
33212 int64x2_t __ret;
33213 __ret = (int64x2_t)(__p0);
33214 return __ret;
33215}
33216__ai int64x2_t vreinterpretq_s64_s32(int32x4_t __p0) {
33217 int64x2_t __ret;
33218 __ret = (int64x2_t)(__p0);
33219 return __ret;
33220}
33221__ai int64x2_t vreinterpretq_s64_s16(int16x8_t __p0) {
33222 int64x2_t __ret;
33223 __ret = (int64x2_t)(__p0);
33224 return __ret;
33225}
33226__ai int16x8_t vreinterpretq_s16_p8(poly8x16_t __p0) {
33227 int16x8_t __ret;
33228 __ret = (int16x8_t)(__p0);
33229 return __ret;
33230}
33231__ai int16x8_t vreinterpretq_s16_p16(poly16x8_t __p0) {
33232 int16x8_t __ret;
33233 __ret = (int16x8_t)(__p0);
33234 return __ret;
33235}
33236__ai int16x8_t vreinterpretq_s16_u8(uint8x16_t __p0) {
33237 int16x8_t __ret;
33238 __ret = (int16x8_t)(__p0);
33239 return __ret;
33240}
33241__ai int16x8_t vreinterpretq_s16_u32(uint32x4_t __p0) {
33242 int16x8_t __ret;
33243 __ret = (int16x8_t)(__p0);
33244 return __ret;
33245}
33246__ai int16x8_t vreinterpretq_s16_u64(uint64x2_t __p0) {
33247 int16x8_t __ret;
33248 __ret = (int16x8_t)(__p0);
33249 return __ret;
33250}
33251__ai int16x8_t vreinterpretq_s16_u16(uint16x8_t __p0) {
33252 int16x8_t __ret;
33253 __ret = (int16x8_t)(__p0);
33254 return __ret;
33255}
33256__ai int16x8_t vreinterpretq_s16_s8(int8x16_t __p0) {
33257 int16x8_t __ret;
33258 __ret = (int16x8_t)(__p0);
33259 return __ret;
33260}
33261__ai int16x8_t vreinterpretq_s16_f32(float32x4_t __p0) {
33262 int16x8_t __ret;
33263 __ret = (int16x8_t)(__p0);
33264 return __ret;
33265}
33266__ai int16x8_t vreinterpretq_s16_f16(float16x8_t __p0) {
33267 int16x8_t __ret;
33268 __ret = (int16x8_t)(__p0);
33269 return __ret;
33270}
33271__ai int16x8_t vreinterpretq_s16_s32(int32x4_t __p0) {
33272 int16x8_t __ret;
33273 __ret = (int16x8_t)(__p0);
33274 return __ret;
33275}
33276__ai int16x8_t vreinterpretq_s16_s64(int64x2_t __p0) {
33277 int16x8_t __ret;
33278 __ret = (int16x8_t)(__p0);
33279 return __ret;
33280}
33281__ai uint8x8_t vreinterpret_u8_p8(poly8x8_t __p0) {
33282 uint8x8_t __ret;
33283 __ret = (uint8x8_t)(__p0);
33284 return __ret;
33285}
33286__ai uint8x8_t vreinterpret_u8_p16(poly16x4_t __p0) {
33287 uint8x8_t __ret;
33288 __ret = (uint8x8_t)(__p0);
33289 return __ret;
33290}
33291__ai uint8x8_t vreinterpret_u8_u32(uint32x2_t __p0) {
33292 uint8x8_t __ret;
33293 __ret = (uint8x8_t)(__p0);
33294 return __ret;
33295}
33296__ai uint8x8_t vreinterpret_u8_u64(uint64x1_t __p0) {
33297 uint8x8_t __ret;
33298 __ret = (uint8x8_t)(__p0);
33299 return __ret;
33300}
33301__ai uint8x8_t vreinterpret_u8_u16(uint16x4_t __p0) {
33302 uint8x8_t __ret;
33303 __ret = (uint8x8_t)(__p0);
33304 return __ret;
33305}
33306__ai uint8x8_t vreinterpret_u8_s8(int8x8_t __p0) {
33307 uint8x8_t __ret;
33308 __ret = (uint8x8_t)(__p0);
33309 return __ret;
33310}
33311__ai uint8x8_t vreinterpret_u8_f32(float32x2_t __p0) {
33312 uint8x8_t __ret;
33313 __ret = (uint8x8_t)(__p0);
33314 return __ret;
33315}
33316__ai uint8x8_t vreinterpret_u8_f16(float16x4_t __p0) {
33317 uint8x8_t __ret;
33318 __ret = (uint8x8_t)(__p0);
33319 return __ret;
33320}
33321__ai uint8x8_t vreinterpret_u8_s32(int32x2_t __p0) {
33322 uint8x8_t __ret;
33323 __ret = (uint8x8_t)(__p0);
33324 return __ret;
33325}
33326__ai uint8x8_t vreinterpret_u8_s64(int64x1_t __p0) {
33327 uint8x8_t __ret;
33328 __ret = (uint8x8_t)(__p0);
33329 return __ret;
33330}
33331__ai uint8x8_t vreinterpret_u8_s16(int16x4_t __p0) {
33332 uint8x8_t __ret;
33333 __ret = (uint8x8_t)(__p0);
33334 return __ret;
33335}
33336__ai uint32x2_t vreinterpret_u32_p8(poly8x8_t __p0) {
33337 uint32x2_t __ret;
33338 __ret = (uint32x2_t)(__p0);
33339 return __ret;
33340}
33341__ai uint32x2_t vreinterpret_u32_p16(poly16x4_t __p0) {
33342 uint32x2_t __ret;
33343 __ret = (uint32x2_t)(__p0);
33344 return __ret;
33345}
33346__ai uint32x2_t vreinterpret_u32_u8(uint8x8_t __p0) {
33347 uint32x2_t __ret;
33348 __ret = (uint32x2_t)(__p0);
33349 return __ret;
33350}
33351__ai uint32x2_t vreinterpret_u32_u64(uint64x1_t __p0) {
33352 uint32x2_t __ret;
33353 __ret = (uint32x2_t)(__p0);
33354 return __ret;
33355}
33356__ai uint32x2_t vreinterpret_u32_u16(uint16x4_t __p0) {
33357 uint32x2_t __ret;
33358 __ret = (uint32x2_t)(__p0);
33359 return __ret;
33360}
33361__ai uint32x2_t vreinterpret_u32_s8(int8x8_t __p0) {
33362 uint32x2_t __ret;
33363 __ret = (uint32x2_t)(__p0);
33364 return __ret;
33365}
33366__ai uint32x2_t vreinterpret_u32_f32(float32x2_t __p0) {
33367 uint32x2_t __ret;
33368 __ret = (uint32x2_t)(__p0);
33369 return __ret;
33370}
33371__ai uint32x2_t vreinterpret_u32_f16(float16x4_t __p0) {
33372 uint32x2_t __ret;
33373 __ret = (uint32x2_t)(__p0);
33876 __ret = (int32x4_t) __builtin_neon_vdotq_s32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 34);
3337433877 return __ret;
3337533878}
33376__ai uint32x2_t vreinterpret_u32_s32(int32x2_t __p0) {
33879#endif
33880
33881#ifdef __LITTLE_ENDIAN__
33882__ai __attribute__((target("dotprod"))) uint32x2_t vdot_u32(uint32x2_t __p0, uint8x8_t __p1, uint8x8_t __p2) {
3337733883 uint32x2_t __ret;
33378 __ret = (uint32x2_t)(__p0);
33884 __ret = (uint32x2_t) __builtin_neon_vdot_u32((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 18);
3337933885 return __ret;
3338033886}
33381__ai uint32x2_t vreinterpret_u32_s64(int64x1_t __p0) {
33887#else
33888__ai __attribute__((target("dotprod"))) uint32x2_t vdot_u32(uint32x2_t __p0, uint8x8_t __p1, uint8x8_t __p2) {
3338233889 uint32x2_t __ret;
33383 __ret = (uint32x2_t)(__p0);
33890 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
33891 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
33892 uint8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
33893 __ret = (uint32x2_t) __builtin_neon_vdot_u32((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 18);
33894 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
3338433895 return __ret;
3338533896}
33386__ai uint32x2_t vreinterpret_u32_s16(int16x4_t __p0) {
33897__ai __attribute__((target("dotprod"))) uint32x2_t __noswap_vdot_u32(uint32x2_t __p0, uint8x8_t __p1, uint8x8_t __p2) {
3338733898 uint32x2_t __ret;
33388 __ret = (uint32x2_t)(__p0);
33389 return __ret;
33390}
33391__ai uint64x1_t vreinterpret_u64_p8(poly8x8_t __p0) {
33392 uint64x1_t __ret;
33393 __ret = (uint64x1_t)(__p0);
33394 return __ret;
33395}
33396__ai uint64x1_t vreinterpret_u64_p16(poly16x4_t __p0) {
33397 uint64x1_t __ret;
33398 __ret = (uint64x1_t)(__p0);
33399 return __ret;
33400}
33401__ai uint64x1_t vreinterpret_u64_u8(uint8x8_t __p0) {
33402 uint64x1_t __ret;
33403 __ret = (uint64x1_t)(__p0);
33404 return __ret;
33405}
33406__ai uint64x1_t vreinterpret_u64_u32(uint32x2_t __p0) {
33407 uint64x1_t __ret;
33408 __ret = (uint64x1_t)(__p0);
33409 return __ret;
33410}
33411__ai uint64x1_t vreinterpret_u64_u16(uint16x4_t __p0) {
33412 uint64x1_t __ret;
33413 __ret = (uint64x1_t)(__p0);
33414 return __ret;
33415}
33416__ai uint64x1_t vreinterpret_u64_s8(int8x8_t __p0) {
33417 uint64x1_t __ret;
33418 __ret = (uint64x1_t)(__p0);
33419 return __ret;
33420}
33421__ai uint64x1_t vreinterpret_u64_f32(float32x2_t __p0) {
33422 uint64x1_t __ret;
33423 __ret = (uint64x1_t)(__p0);
33424 return __ret;
33425}
33426__ai uint64x1_t vreinterpret_u64_f16(float16x4_t __p0) {
33427 uint64x1_t __ret;
33428 __ret = (uint64x1_t)(__p0);
33429 return __ret;
33430}
33431__ai uint64x1_t vreinterpret_u64_s32(int32x2_t __p0) {
33432 uint64x1_t __ret;
33433 __ret = (uint64x1_t)(__p0);
33434 return __ret;
33435}
33436__ai uint64x1_t vreinterpret_u64_s64(int64x1_t __p0) {
33437 uint64x1_t __ret;
33438 __ret = (uint64x1_t)(__p0);
33899 __ret = (uint32x2_t) __builtin_neon_vdot_u32((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 18);
3343933900 return __ret;
3344033901}
33441__ai uint64x1_t vreinterpret_u64_s16(int16x4_t __p0) {
33442 uint64x1_t __ret;
33443 __ret = (uint64x1_t)(__p0);
33902#endif
33903
33904#ifdef __LITTLE_ENDIAN__
33905__ai __attribute__((target("dotprod"))) int32x2_t vdot_s32(int32x2_t __p0, int8x8_t __p1, int8x8_t __p2) {
33906 int32x2_t __ret;
33907 __ret = (int32x2_t) __builtin_neon_vdot_s32((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 2);
3344433908 return __ret;
3344533909}
33446__ai uint16x4_t vreinterpret_u16_p8(poly8x8_t __p0) {
33447 uint16x4_t __ret;
33448 __ret = (uint16x4_t)(__p0);
33910#else
33911__ai __attribute__((target("dotprod"))) int32x2_t vdot_s32(int32x2_t __p0, int8x8_t __p1, int8x8_t __p2) {
33912 int32x2_t __ret;
33913 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
33914 int8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
33915 int8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
33916 __ret = (int32x2_t) __builtin_neon_vdot_s32((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 2);
33917 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
3344933918 return __ret;
3345033919}
33451__ai uint16x4_t vreinterpret_u16_p16(poly16x4_t __p0) {
33452 uint16x4_t __ret;
33453 __ret = (uint16x4_t)(__p0);
33920__ai __attribute__((target("dotprod"))) int32x2_t __noswap_vdot_s32(int32x2_t __p0, int8x8_t __p1, int8x8_t __p2) {
33921 int32x2_t __ret;
33922 __ret = (int32x2_t) __builtin_neon_vdot_s32((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 2);
3345433923 return __ret;
3345533924}
33456__ai uint16x4_t vreinterpret_u16_u8(uint8x8_t __p0) {
33457 uint16x4_t __ret;
33458 __ret = (uint16x4_t)(__p0);
33925#endif
33926
33927#ifdef __LITTLE_ENDIAN__
33928#define vdotq_lane_u32(__p0_145, __p1_145, __p2_145, __p3_145) __extension__ ({ \
33929 uint32x4_t __ret_145; \
33930 uint32x4_t __s0_145 = __p0_145; \
33931 uint8x16_t __s1_145 = __p1_145; \
33932 uint8x8_t __s2_145 = __p2_145; \
33933uint8x8_t __reint_145 = __s2_145; \
33934uint32x4_t __reint1_145 = splatq_lane_u32(*(uint32x2_t *) &__reint_145, __p3_145); \
33935 __ret_145 = vdotq_u32(__s0_145, __s1_145, *(uint8x16_t *) &__reint1_145); \
33936 __ret_145; \
33937})
33938#else
33939#define vdotq_lane_u32(__p0_146, __p1_146, __p2_146, __p3_146) __extension__ ({ \
33940 uint32x4_t __ret_146; \
33941 uint32x4_t __s0_146 = __p0_146; \
33942 uint8x16_t __s1_146 = __p1_146; \
33943 uint8x8_t __s2_146 = __p2_146; \
33944 uint32x4_t __rev0_146; __rev0_146 = __builtin_shufflevector(__s0_146, __s0_146, 3, 2, 1, 0); \
33945 uint8x16_t __rev1_146; __rev1_146 = __builtin_shufflevector(__s1_146, __s1_146, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
33946 uint8x8_t __rev2_146; __rev2_146 = __builtin_shufflevector(__s2_146, __s2_146, 7, 6, 5, 4, 3, 2, 1, 0); \
33947uint8x8_t __reint_146 = __rev2_146; \
33948uint32x4_t __reint1_146 = __noswap_splatq_lane_u32(*(uint32x2_t *) &__reint_146, __p3_146); \
33949 __ret_146 = __noswap_vdotq_u32(__rev0_146, __rev1_146, *(uint8x16_t *) &__reint1_146); \
33950 __ret_146 = __builtin_shufflevector(__ret_146, __ret_146, 3, 2, 1, 0); \
33951 __ret_146; \
33952})
33953#endif
33954
33955#ifdef __LITTLE_ENDIAN__
33956#define vdotq_lane_s32(__p0_147, __p1_147, __p2_147, __p3_147) __extension__ ({ \
33957 int32x4_t __ret_147; \
33958 int32x4_t __s0_147 = __p0_147; \
33959 int8x16_t __s1_147 = __p1_147; \
33960 int8x8_t __s2_147 = __p2_147; \
33961int8x8_t __reint_147 = __s2_147; \
33962int32x4_t __reint1_147 = splatq_lane_s32(*(int32x2_t *) &__reint_147, __p3_147); \
33963 __ret_147 = vdotq_s32(__s0_147, __s1_147, *(int8x16_t *) &__reint1_147); \
33964 __ret_147; \
33965})
33966#else
33967#define vdotq_lane_s32(__p0_148, __p1_148, __p2_148, __p3_148) __extension__ ({ \
33968 int32x4_t __ret_148; \
33969 int32x4_t __s0_148 = __p0_148; \
33970 int8x16_t __s1_148 = __p1_148; \
33971 int8x8_t __s2_148 = __p2_148; \
33972 int32x4_t __rev0_148; __rev0_148 = __builtin_shufflevector(__s0_148, __s0_148, 3, 2, 1, 0); \
33973 int8x16_t __rev1_148; __rev1_148 = __builtin_shufflevector(__s1_148, __s1_148, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
33974 int8x8_t __rev2_148; __rev2_148 = __builtin_shufflevector(__s2_148, __s2_148, 7, 6, 5, 4, 3, 2, 1, 0); \
33975int8x8_t __reint_148 = __rev2_148; \
33976int32x4_t __reint1_148 = __noswap_splatq_lane_s32(*(int32x2_t *) &__reint_148, __p3_148); \
33977 __ret_148 = __noswap_vdotq_s32(__rev0_148, __rev1_148, *(int8x16_t *) &__reint1_148); \
33978 __ret_148 = __builtin_shufflevector(__ret_148, __ret_148, 3, 2, 1, 0); \
33979 __ret_148; \
33980})
33981#endif
33982
33983#ifdef __LITTLE_ENDIAN__
33984#define vdot_lane_u32(__p0_149, __p1_149, __p2_149, __p3_149) __extension__ ({ \
33985 uint32x2_t __ret_149; \
33986 uint32x2_t __s0_149 = __p0_149; \
33987 uint8x8_t __s1_149 = __p1_149; \
33988 uint8x8_t __s2_149 = __p2_149; \
33989uint8x8_t __reint_149 = __s2_149; \
33990uint32x2_t __reint1_149 = splat_lane_u32(*(uint32x2_t *) &__reint_149, __p3_149); \
33991 __ret_149 = vdot_u32(__s0_149, __s1_149, *(uint8x8_t *) &__reint1_149); \
33992 __ret_149; \
33993})
33994#else
33995#define vdot_lane_u32(__p0_150, __p1_150, __p2_150, __p3_150) __extension__ ({ \
33996 uint32x2_t __ret_150; \
33997 uint32x2_t __s0_150 = __p0_150; \
33998 uint8x8_t __s1_150 = __p1_150; \
33999 uint8x8_t __s2_150 = __p2_150; \
34000 uint32x2_t __rev0_150; __rev0_150 = __builtin_shufflevector(__s0_150, __s0_150, 1, 0); \
34001 uint8x8_t __rev1_150; __rev1_150 = __builtin_shufflevector(__s1_150, __s1_150, 7, 6, 5, 4, 3, 2, 1, 0); \
34002 uint8x8_t __rev2_150; __rev2_150 = __builtin_shufflevector(__s2_150, __s2_150, 7, 6, 5, 4, 3, 2, 1, 0); \
34003uint8x8_t __reint_150 = __rev2_150; \
34004uint32x2_t __reint1_150 = __noswap_splat_lane_u32(*(uint32x2_t *) &__reint_150, __p3_150); \
34005 __ret_150 = __noswap_vdot_u32(__rev0_150, __rev1_150, *(uint8x8_t *) &__reint1_150); \
34006 __ret_150 = __builtin_shufflevector(__ret_150, __ret_150, 1, 0); \
34007 __ret_150; \
34008})
34009#endif
34010
34011#ifdef __LITTLE_ENDIAN__
34012#define vdot_lane_s32(__p0_151, __p1_151, __p2_151, __p3_151) __extension__ ({ \
34013 int32x2_t __ret_151; \
34014 int32x2_t __s0_151 = __p0_151; \
34015 int8x8_t __s1_151 = __p1_151; \
34016 int8x8_t __s2_151 = __p2_151; \
34017int8x8_t __reint_151 = __s2_151; \
34018int32x2_t __reint1_151 = splat_lane_s32(*(int32x2_t *) &__reint_151, __p3_151); \
34019 __ret_151 = vdot_s32(__s0_151, __s1_151, *(int8x8_t *) &__reint1_151); \
34020 __ret_151; \
34021})
34022#else
34023#define vdot_lane_s32(__p0_152, __p1_152, __p2_152, __p3_152) __extension__ ({ \
34024 int32x2_t __ret_152; \
34025 int32x2_t __s0_152 = __p0_152; \
34026 int8x8_t __s1_152 = __p1_152; \
34027 int8x8_t __s2_152 = __p2_152; \
34028 int32x2_t __rev0_152; __rev0_152 = __builtin_shufflevector(__s0_152, __s0_152, 1, 0); \
34029 int8x8_t __rev1_152; __rev1_152 = __builtin_shufflevector(__s1_152, __s1_152, 7, 6, 5, 4, 3, 2, 1, 0); \
34030 int8x8_t __rev2_152; __rev2_152 = __builtin_shufflevector(__s2_152, __s2_152, 7, 6, 5, 4, 3, 2, 1, 0); \
34031int8x8_t __reint_152 = __rev2_152; \
34032int32x2_t __reint1_152 = __noswap_splat_lane_s32(*(int32x2_t *) &__reint_152, __p3_152); \
34033 __ret_152 = __noswap_vdot_s32(__rev0_152, __rev1_152, *(int8x8_t *) &__reint1_152); \
34034 __ret_152 = __builtin_shufflevector(__ret_152, __ret_152, 1, 0); \
34035 __ret_152; \
34036})
34037#endif
34038
34039#ifdef __LITTLE_ENDIAN__
34040__ai __attribute__((target("fullfp16"))) float16x8_t vabdq_f16(float16x8_t __p0, float16x8_t __p1) {
34041 float16x8_t __ret;
34042 __ret = (float16x8_t) __builtin_neon_vabdq_f16((int8x16_t)__p0, (int8x16_t)__p1, 40);
3345934043 return __ret;
3346034044}
33461__ai uint16x4_t vreinterpret_u16_u32(uint32x2_t __p0) {
33462 uint16x4_t __ret;
33463 __ret = (uint16x4_t)(__p0);
34045#else
34046__ai __attribute__((target("fullfp16"))) float16x8_t vabdq_f16(float16x8_t __p0, float16x8_t __p1) {
34047 float16x8_t __ret;
34048 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
34049 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
34050 __ret = (float16x8_t) __builtin_neon_vabdq_f16((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
34051 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
3346434052 return __ret;
3346534053}
33466__ai uint16x4_t vreinterpret_u16_u64(uint64x1_t __p0) {
33467 uint16x4_t __ret;
33468 __ret = (uint16x4_t)(__p0);
34054#endif
34055
34056#ifdef __LITTLE_ENDIAN__
34057__ai __attribute__((target("fullfp16"))) float16x4_t vabd_f16(float16x4_t __p0, float16x4_t __p1) {
34058 float16x4_t __ret;
34059 __ret = (float16x4_t) __builtin_neon_vabd_f16((int8x8_t)__p0, (int8x8_t)__p1, 8);
3346934060 return __ret;
3347034061}
33471__ai uint16x4_t vreinterpret_u16_s8(int8x8_t __p0) {
33472 uint16x4_t __ret;
33473 __ret = (uint16x4_t)(__p0);
34062#else
34063__ai __attribute__((target("fullfp16"))) float16x4_t vabd_f16(float16x4_t __p0, float16x4_t __p1) {
34064 float16x4_t __ret;
34065 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34066 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
34067 __ret = (float16x4_t) __builtin_neon_vabd_f16((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
34068 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3347434069 return __ret;
3347534070}
33476__ai uint16x4_t vreinterpret_u16_f32(float32x2_t __p0) {
33477 uint16x4_t __ret;
33478 __ret = (uint16x4_t)(__p0);
34071#endif
34072
34073#ifdef __LITTLE_ENDIAN__
34074__ai __attribute__((target("fullfp16"))) float16x8_t vabsq_f16(float16x8_t __p0) {
34075 float16x8_t __ret;
34076 __ret = (float16x8_t) __builtin_neon_vabsq_f16((int8x16_t)__p0, 40);
3347934077 return __ret;
3348034078}
33481__ai uint16x4_t vreinterpret_u16_f16(float16x4_t __p0) {
33482 uint16x4_t __ret;
33483 __ret = (uint16x4_t)(__p0);
34079#else
34080__ai __attribute__((target("fullfp16"))) float16x8_t vabsq_f16(float16x8_t __p0) {
34081 float16x8_t __ret;
34082 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
34083 __ret = (float16x8_t) __builtin_neon_vabsq_f16((int8x16_t)__rev0, 40);
34084 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
3348434085 return __ret;
3348534086}
33486__ai uint16x4_t vreinterpret_u16_s32(int32x2_t __p0) {
33487 uint16x4_t __ret;
33488 __ret = (uint16x4_t)(__p0);
34087#endif
34088
34089#ifdef __LITTLE_ENDIAN__
34090__ai __attribute__((target("fullfp16"))) float16x4_t vabs_f16(float16x4_t __p0) {
34091 float16x4_t __ret;
34092 __ret = (float16x4_t) __builtin_neon_vabs_f16((int8x8_t)__p0, 8);
3348934093 return __ret;
3349034094}
33491__ai uint16x4_t vreinterpret_u16_s64(int64x1_t __p0) {
33492 uint16x4_t __ret;
33493 __ret = (uint16x4_t)(__p0);
34095#else
34096__ai __attribute__((target("fullfp16"))) float16x4_t vabs_f16(float16x4_t __p0) {
34097 float16x4_t __ret;
34098 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34099 __ret = (float16x4_t) __builtin_neon_vabs_f16((int8x8_t)__rev0, 8);
34100 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3349434101 return __ret;
3349534102}
33496__ai uint16x4_t vreinterpret_u16_s16(int16x4_t __p0) {
33497 uint16x4_t __ret;
33498 __ret = (uint16x4_t)(__p0);
34103#endif
34104
34105#ifdef __LITTLE_ENDIAN__
34106__ai __attribute__((target("fullfp16"))) float16x8_t vaddq_f16(float16x8_t __p0, float16x8_t __p1) {
34107 float16x8_t __ret;
34108 __ret = __p0 + __p1;
3349934109 return __ret;
3350034110}
33501__ai int8x8_t vreinterpret_s8_p8(poly8x8_t __p0) {
33502 int8x8_t __ret;
33503 __ret = (int8x8_t)(__p0);
34111#else
34112__ai __attribute__((target("fullfp16"))) float16x8_t vaddq_f16(float16x8_t __p0, float16x8_t __p1) {
34113 float16x8_t __ret;
34114 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
34115 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
34116 __ret = __rev0 + __rev1;
34117 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
3350434118 return __ret;
3350534119}
33506__ai int8x8_t vreinterpret_s8_p16(poly16x4_t __p0) {
33507 int8x8_t __ret;
33508 __ret = (int8x8_t)(__p0);
34120#endif
34121
34122#ifdef __LITTLE_ENDIAN__
34123__ai __attribute__((target("fullfp16"))) float16x4_t vadd_f16(float16x4_t __p0, float16x4_t __p1) {
34124 float16x4_t __ret;
34125 __ret = __p0 + __p1;
3350934126 return __ret;
3351034127}
33511__ai int8x8_t vreinterpret_s8_u8(uint8x8_t __p0) {
33512 int8x8_t __ret;
33513 __ret = (int8x8_t)(__p0);
34128#else
34129__ai __attribute__((target("fullfp16"))) float16x4_t vadd_f16(float16x4_t __p0, float16x4_t __p1) {
34130 float16x4_t __ret;
34131 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34132 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
34133 __ret = __rev0 + __rev1;
34134 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3351434135 return __ret;
3351534136}
33516__ai int8x8_t vreinterpret_s8_u32(uint32x2_t __p0) {
33517 int8x8_t __ret;
33518 __ret = (int8x8_t)(__p0);
34137#endif
34138
34139#ifdef __LITTLE_ENDIAN__
34140__ai __attribute__((target("fullfp16"))) float16x8_t vbslq_f16(uint16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
34141 float16x8_t __ret;
34142 __ret = (float16x8_t) __builtin_neon_vbslq_f16((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 40);
3351934143 return __ret;
3352034144}
33521__ai int8x8_t vreinterpret_s8_u64(uint64x1_t __p0) {
33522 int8x8_t __ret;
33523 __ret = (int8x8_t)(__p0);
34145#else
34146__ai __attribute__((target("fullfp16"))) float16x8_t vbslq_f16(uint16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
34147 float16x8_t __ret;
34148 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
34149 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
34150 float16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
34151 __ret = (float16x8_t) __builtin_neon_vbslq_f16((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 40);
34152 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
3352434153 return __ret;
3352534154}
33526__ai int8x8_t vreinterpret_s8_u16(uint16x4_t __p0) {
33527 int8x8_t __ret;
33528 __ret = (int8x8_t)(__p0);
34155#endif
34156
34157#ifdef __LITTLE_ENDIAN__
34158__ai __attribute__((target("fullfp16"))) float16x4_t vbsl_f16(uint16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
34159 float16x4_t __ret;
34160 __ret = (float16x4_t) __builtin_neon_vbsl_f16((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 8);
3352934161 return __ret;
3353034162}
33531__ai int8x8_t vreinterpret_s8_f32(float32x2_t __p0) {
33532 int8x8_t __ret;
33533 __ret = (int8x8_t)(__p0);
34163#else
34164__ai __attribute__((target("fullfp16"))) float16x4_t vbsl_f16(uint16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
34165 float16x4_t __ret;
34166 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34167 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
34168 float16x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
34169 __ret = (float16x4_t) __builtin_neon_vbsl_f16((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 8);
34170 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3353434171 return __ret;
3353534172}
33536__ai int8x8_t vreinterpret_s8_f16(float16x4_t __p0) {
33537 int8x8_t __ret;
33538 __ret = (int8x8_t)(__p0);
34173#endif
34174
34175#ifdef __LITTLE_ENDIAN__
34176__ai __attribute__((target("fullfp16"))) uint16x8_t vcageq_f16(float16x8_t __p0, float16x8_t __p1) {
34177 uint16x8_t __ret;
34178 __ret = (uint16x8_t) __builtin_neon_vcageq_f16((int8x16_t)__p0, (int8x16_t)__p1, 49);
3353934179 return __ret;
3354034180}
33541__ai int8x8_t vreinterpret_s8_s32(int32x2_t __p0) {
33542 int8x8_t __ret;
33543 __ret = (int8x8_t)(__p0);
34181#else
34182__ai __attribute__((target("fullfp16"))) uint16x8_t vcageq_f16(float16x8_t __p0, float16x8_t __p1) {
34183 uint16x8_t __ret;
34184 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
34185 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
34186 __ret = (uint16x8_t) __builtin_neon_vcageq_f16((int8x16_t)__rev0, (int8x16_t)__rev1, 49);
34187 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
3354434188 return __ret;
3354534189}
33546__ai int8x8_t vreinterpret_s8_s64(int64x1_t __p0) {
33547 int8x8_t __ret;
33548 __ret = (int8x8_t)(__p0);
34190#endif
34191
34192#ifdef __LITTLE_ENDIAN__
34193__ai __attribute__((target("fullfp16"))) uint16x4_t vcage_f16(float16x4_t __p0, float16x4_t __p1) {
34194 uint16x4_t __ret;
34195 __ret = (uint16x4_t) __builtin_neon_vcage_f16((int8x8_t)__p0, (int8x8_t)__p1, 17);
3354934196 return __ret;
3355034197}
33551__ai int8x8_t vreinterpret_s8_s16(int16x4_t __p0) {
33552 int8x8_t __ret;
33553 __ret = (int8x8_t)(__p0);
34198#else
34199__ai __attribute__((target("fullfp16"))) uint16x4_t vcage_f16(float16x4_t __p0, float16x4_t __p1) {
34200 uint16x4_t __ret;
34201 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34202 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
34203 __ret = (uint16x4_t) __builtin_neon_vcage_f16((int8x8_t)__rev0, (int8x8_t)__rev1, 17);
34204 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3355434205 return __ret;
3355534206}
33556__ai float32x2_t vreinterpret_f32_p8(poly8x8_t __p0) {
33557 float32x2_t __ret;
33558 __ret = (float32x2_t)(__p0);
34207#endif
34208
34209#ifdef __LITTLE_ENDIAN__
34210__ai __attribute__((target("fullfp16"))) uint16x8_t vcagtq_f16(float16x8_t __p0, float16x8_t __p1) {
34211 uint16x8_t __ret;
34212 __ret = (uint16x8_t) __builtin_neon_vcagtq_f16((int8x16_t)__p0, (int8x16_t)__p1, 49);
3355934213 return __ret;
3356034214}
33561__ai float32x2_t vreinterpret_f32_p16(poly16x4_t __p0) {
33562 float32x2_t __ret;
33563 __ret = (float32x2_t)(__p0);
34215#else
34216__ai __attribute__((target("fullfp16"))) uint16x8_t vcagtq_f16(float16x8_t __p0, float16x8_t __p1) {
34217 uint16x8_t __ret;
34218 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
34219 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
34220 __ret = (uint16x8_t) __builtin_neon_vcagtq_f16((int8x16_t)__rev0, (int8x16_t)__rev1, 49);
34221 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
3356434222 return __ret;
3356534223}
33566__ai float32x2_t vreinterpret_f32_u8(uint8x8_t __p0) {
33567 float32x2_t __ret;
33568 __ret = (float32x2_t)(__p0);
34224#endif
34225
34226#ifdef __LITTLE_ENDIAN__
34227__ai __attribute__((target("fullfp16"))) uint16x4_t vcagt_f16(float16x4_t __p0, float16x4_t __p1) {
34228 uint16x4_t __ret;
34229 __ret = (uint16x4_t) __builtin_neon_vcagt_f16((int8x8_t)__p0, (int8x8_t)__p1, 17);
3356934230 return __ret;
3357034231}
33571__ai float32x2_t vreinterpret_f32_u32(uint32x2_t __p0) {
33572 float32x2_t __ret;
33573 __ret = (float32x2_t)(__p0);
34232#else
34233__ai __attribute__((target("fullfp16"))) uint16x4_t vcagt_f16(float16x4_t __p0, float16x4_t __p1) {
34234 uint16x4_t __ret;
34235 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34236 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
34237 __ret = (uint16x4_t) __builtin_neon_vcagt_f16((int8x8_t)__rev0, (int8x8_t)__rev1, 17);
34238 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3357434239 return __ret;
3357534240}
33576__ai float32x2_t vreinterpret_f32_u64(uint64x1_t __p0) {
33577 float32x2_t __ret;
33578 __ret = (float32x2_t)(__p0);
34241#endif
34242
34243#ifdef __LITTLE_ENDIAN__
34244__ai __attribute__((target("fullfp16"))) uint16x8_t vcaleq_f16(float16x8_t __p0, float16x8_t __p1) {
34245 uint16x8_t __ret;
34246 __ret = (uint16x8_t) __builtin_neon_vcaleq_f16((int8x16_t)__p0, (int8x16_t)__p1, 49);
3357934247 return __ret;
3358034248}
33581__ai float32x2_t vreinterpret_f32_u16(uint16x4_t __p0) {
33582 float32x2_t __ret;
33583 __ret = (float32x2_t)(__p0);
34249#else
34250__ai __attribute__((target("fullfp16"))) uint16x8_t vcaleq_f16(float16x8_t __p0, float16x8_t __p1) {
34251 uint16x8_t __ret;
34252 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
34253 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
34254 __ret = (uint16x8_t) __builtin_neon_vcaleq_f16((int8x16_t)__rev0, (int8x16_t)__rev1, 49);
34255 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
3358434256 return __ret;
3358534257}
33586__ai float32x2_t vreinterpret_f32_s8(int8x8_t __p0) {
33587 float32x2_t __ret;
33588 __ret = (float32x2_t)(__p0);
34258#endif
34259
34260#ifdef __LITTLE_ENDIAN__
34261__ai __attribute__((target("fullfp16"))) uint16x4_t vcale_f16(float16x4_t __p0, float16x4_t __p1) {
34262 uint16x4_t __ret;
34263 __ret = (uint16x4_t) __builtin_neon_vcale_f16((int8x8_t)__p0, (int8x8_t)__p1, 17);
3358934264 return __ret;
3359034265}
33591__ai float32x2_t vreinterpret_f32_f16(float16x4_t __p0) {
33592 float32x2_t __ret;
33593 __ret = (float32x2_t)(__p0);
34266#else
34267__ai __attribute__((target("fullfp16"))) uint16x4_t vcale_f16(float16x4_t __p0, float16x4_t __p1) {
34268 uint16x4_t __ret;
34269 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34270 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
34271 __ret = (uint16x4_t) __builtin_neon_vcale_f16((int8x8_t)__rev0, (int8x8_t)__rev1, 17);
34272 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3359434273 return __ret;
3359534274}
33596__ai float32x2_t vreinterpret_f32_s32(int32x2_t __p0) {
33597 float32x2_t __ret;
33598 __ret = (float32x2_t)(__p0);
34275#endif
34276
34277#ifdef __LITTLE_ENDIAN__
34278__ai __attribute__((target("fullfp16"))) uint16x8_t vcaltq_f16(float16x8_t __p0, float16x8_t __p1) {
34279 uint16x8_t __ret;
34280 __ret = (uint16x8_t) __builtin_neon_vcaltq_f16((int8x16_t)__p0, (int8x16_t)__p1, 49);
3359934281 return __ret;
3360034282}
33601__ai float32x2_t vreinterpret_f32_s64(int64x1_t __p0) {
33602 float32x2_t __ret;
33603 __ret = (float32x2_t)(__p0);
34283#else
34284__ai __attribute__((target("fullfp16"))) uint16x8_t vcaltq_f16(float16x8_t __p0, float16x8_t __p1) {
34285 uint16x8_t __ret;
34286 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
34287 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
34288 __ret = (uint16x8_t) __builtin_neon_vcaltq_f16((int8x16_t)__rev0, (int8x16_t)__rev1, 49);
34289 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
3360434290 return __ret;
3360534291}
33606__ai float32x2_t vreinterpret_f32_s16(int16x4_t __p0) {
33607 float32x2_t __ret;
33608 __ret = (float32x2_t)(__p0);
34292#endif
34293
34294#ifdef __LITTLE_ENDIAN__
34295__ai __attribute__((target("fullfp16"))) uint16x4_t vcalt_f16(float16x4_t __p0, float16x4_t __p1) {
34296 uint16x4_t __ret;
34297 __ret = (uint16x4_t) __builtin_neon_vcalt_f16((int8x8_t)__p0, (int8x8_t)__p1, 17);
3360934298 return __ret;
3361034299}
33611__ai float16x4_t vreinterpret_f16_p8(poly8x8_t __p0) {
33612 float16x4_t __ret;
33613 __ret = (float16x4_t)(__p0);
34300#else
34301__ai __attribute__((target("fullfp16"))) uint16x4_t vcalt_f16(float16x4_t __p0, float16x4_t __p1) {
34302 uint16x4_t __ret;
34303 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34304 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
34305 __ret = (uint16x4_t) __builtin_neon_vcalt_f16((int8x8_t)__rev0, (int8x8_t)__rev1, 17);
34306 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3361434307 return __ret;
3361534308}
33616__ai float16x4_t vreinterpret_f16_p16(poly16x4_t __p0) {
33617 float16x4_t __ret;
33618 __ret = (float16x4_t)(__p0);
34309#endif
34310
34311#ifdef __LITTLE_ENDIAN__
34312__ai __attribute__((target("fullfp16"))) uint16x8_t vceqq_f16(float16x8_t __p0, float16x8_t __p1) {
34313 uint16x8_t __ret;
34314 __ret = (uint16x8_t)(__p0 == __p1);
3361934315 return __ret;
3362034316}
33621__ai float16x4_t vreinterpret_f16_u8(uint8x8_t __p0) {
33622 float16x4_t __ret;
33623 __ret = (float16x4_t)(__p0);
34317#else
34318__ai __attribute__((target("fullfp16"))) uint16x8_t vceqq_f16(float16x8_t __p0, float16x8_t __p1) {
34319 uint16x8_t __ret;
34320 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
34321 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
34322 __ret = (uint16x8_t)(__rev0 == __rev1);
34323 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
3362434324 return __ret;
3362534325}
33626__ai float16x4_t vreinterpret_f16_u32(uint32x2_t __p0) {
33627 float16x4_t __ret;
33628 __ret = (float16x4_t)(__p0);
34326#endif
34327
34328#ifdef __LITTLE_ENDIAN__
34329__ai __attribute__((target("fullfp16"))) uint16x4_t vceq_f16(float16x4_t __p0, float16x4_t __p1) {
34330 uint16x4_t __ret;
34331 __ret = (uint16x4_t)(__p0 == __p1);
3362934332 return __ret;
3363034333}
33631__ai float16x4_t vreinterpret_f16_u64(uint64x1_t __p0) {
33632 float16x4_t __ret;
33633 __ret = (float16x4_t)(__p0);
34334#else
34335__ai __attribute__((target("fullfp16"))) uint16x4_t vceq_f16(float16x4_t __p0, float16x4_t __p1) {
34336 uint16x4_t __ret;
34337 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34338 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
34339 __ret = (uint16x4_t)(__rev0 == __rev1);
34340 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3363434341 return __ret;
3363534342}
33636__ai float16x4_t vreinterpret_f16_u16(uint16x4_t __p0) {
33637 float16x4_t __ret;
33638 __ret = (float16x4_t)(__p0);
34343#endif
34344
34345#ifdef __LITTLE_ENDIAN__
34346__ai __attribute__((target("fullfp16"))) uint16x8_t vceqzq_f16(float16x8_t __p0) {
34347 uint16x8_t __ret;
34348 __ret = (uint16x8_t) __builtin_neon_vceqzq_f16((int8x16_t)__p0, 49);
3363934349 return __ret;
3364034350}
33641__ai float16x4_t vreinterpret_f16_s8(int8x8_t __p0) {
33642 float16x4_t __ret;
33643 __ret = (float16x4_t)(__p0);
34351#else
34352__ai __attribute__((target("fullfp16"))) uint16x8_t vceqzq_f16(float16x8_t __p0) {
34353 uint16x8_t __ret;
34354 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
34355 __ret = (uint16x8_t) __builtin_neon_vceqzq_f16((int8x16_t)__rev0, 49);
34356 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
3364434357 return __ret;
3364534358}
33646__ai float16x4_t vreinterpret_f16_f32(float32x2_t __p0) {
33647 float16x4_t __ret;
33648 __ret = (float16x4_t)(__p0);
34359#endif
34360
34361#ifdef __LITTLE_ENDIAN__
34362__ai __attribute__((target("fullfp16"))) uint16x4_t vceqz_f16(float16x4_t __p0) {
34363 uint16x4_t __ret;
34364 __ret = (uint16x4_t) __builtin_neon_vceqz_f16((int8x8_t)__p0, 17);
3364934365 return __ret;
3365034366}
33651__ai float16x4_t vreinterpret_f16_s32(int32x2_t __p0) {
33652 float16x4_t __ret;
33653 __ret = (float16x4_t)(__p0);
34367#else
34368__ai __attribute__((target("fullfp16"))) uint16x4_t vceqz_f16(float16x4_t __p0) {
34369 uint16x4_t __ret;
34370 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34371 __ret = (uint16x4_t) __builtin_neon_vceqz_f16((int8x8_t)__rev0, 17);
34372 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3365434373 return __ret;
3365534374}
33656__ai float16x4_t vreinterpret_f16_s64(int64x1_t __p0) {
33657 float16x4_t __ret;
33658 __ret = (float16x4_t)(__p0);
34375#endif
34376
34377#ifdef __LITTLE_ENDIAN__
34378__ai __attribute__((target("fullfp16"))) uint16x8_t vcgeq_f16(float16x8_t __p0, float16x8_t __p1) {
34379 uint16x8_t __ret;
34380 __ret = (uint16x8_t)(__p0 >= __p1);
3365934381 return __ret;
3366034382}
33661__ai float16x4_t vreinterpret_f16_s16(int16x4_t __p0) {
33662 float16x4_t __ret;
33663 __ret = (float16x4_t)(__p0);
34383#else
34384__ai __attribute__((target("fullfp16"))) uint16x8_t vcgeq_f16(float16x8_t __p0, float16x8_t __p1) {
34385 uint16x8_t __ret;
34386 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
34387 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
34388 __ret = (uint16x8_t)(__rev0 >= __rev1);
34389 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
3366434390 return __ret;
3366534391}
33666__ai int32x2_t vreinterpret_s32_p8(poly8x8_t __p0) {
33667 int32x2_t __ret;
33668 __ret = (int32x2_t)(__p0);
34392#endif
34393
34394#ifdef __LITTLE_ENDIAN__
34395__ai __attribute__((target("fullfp16"))) uint16x4_t vcge_f16(float16x4_t __p0, float16x4_t __p1) {
34396 uint16x4_t __ret;
34397 __ret = (uint16x4_t)(__p0 >= __p1);
3366934398 return __ret;
3367034399}
33671__ai int32x2_t vreinterpret_s32_p16(poly16x4_t __p0) {
33672 int32x2_t __ret;
33673 __ret = (int32x2_t)(__p0);
34400#else
34401__ai __attribute__((target("fullfp16"))) uint16x4_t vcge_f16(float16x4_t __p0, float16x4_t __p1) {
34402 uint16x4_t __ret;
34403 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34404 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
34405 __ret = (uint16x4_t)(__rev0 >= __rev1);
34406 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3367434407 return __ret;
3367534408}
33676__ai int32x2_t vreinterpret_s32_u8(uint8x8_t __p0) {
33677 int32x2_t __ret;
33678 __ret = (int32x2_t)(__p0);
34409#endif
34410
34411#ifdef __LITTLE_ENDIAN__
34412__ai __attribute__((target("fullfp16"))) uint16x8_t vcgezq_f16(float16x8_t __p0) {
34413 uint16x8_t __ret;
34414 __ret = (uint16x8_t) __builtin_neon_vcgezq_f16((int8x16_t)__p0, 49);
3367934415 return __ret;
3368034416}
33681__ai int32x2_t vreinterpret_s32_u32(uint32x2_t __p0) {
33682 int32x2_t __ret;
33683 __ret = (int32x2_t)(__p0);
34417#else
34418__ai __attribute__((target("fullfp16"))) uint16x8_t vcgezq_f16(float16x8_t __p0) {
34419 uint16x8_t __ret;
34420 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
34421 __ret = (uint16x8_t) __builtin_neon_vcgezq_f16((int8x16_t)__rev0, 49);
34422 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
3368434423 return __ret;
3368534424}
33686__ai int32x2_t vreinterpret_s32_u64(uint64x1_t __p0) {
33687 int32x2_t __ret;
33688 __ret = (int32x2_t)(__p0);
34425#endif
34426
34427#ifdef __LITTLE_ENDIAN__
34428__ai __attribute__((target("fullfp16"))) uint16x4_t vcgez_f16(float16x4_t __p0) {
34429 uint16x4_t __ret;
34430 __ret = (uint16x4_t) __builtin_neon_vcgez_f16((int8x8_t)__p0, 17);
3368934431 return __ret;
3369034432}
33691__ai int32x2_t vreinterpret_s32_u16(uint16x4_t __p0) {
33692 int32x2_t __ret;
33693 __ret = (int32x2_t)(__p0);
34433#else
34434__ai __attribute__((target("fullfp16"))) uint16x4_t vcgez_f16(float16x4_t __p0) {
34435 uint16x4_t __ret;
34436 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34437 __ret = (uint16x4_t) __builtin_neon_vcgez_f16((int8x8_t)__rev0, 17);
34438 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3369434439 return __ret;
3369534440}
33696__ai int32x2_t vreinterpret_s32_s8(int8x8_t __p0) {
33697 int32x2_t __ret;
33698 __ret = (int32x2_t)(__p0);
34441#endif
34442
34443#ifdef __LITTLE_ENDIAN__
34444__ai __attribute__((target("fullfp16"))) uint16x8_t vcgtq_f16(float16x8_t __p0, float16x8_t __p1) {
34445 uint16x8_t __ret;
34446 __ret = (uint16x8_t)(__p0 > __p1);
3369934447 return __ret;
3370034448}
33701__ai int32x2_t vreinterpret_s32_f32(float32x2_t __p0) {
33702 int32x2_t __ret;
33703 __ret = (int32x2_t)(__p0);
34449#else
34450__ai __attribute__((target("fullfp16"))) uint16x8_t vcgtq_f16(float16x8_t __p0, float16x8_t __p1) {
34451 uint16x8_t __ret;
34452 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
34453 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
34454 __ret = (uint16x8_t)(__rev0 > __rev1);
34455 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
3370434456 return __ret;
3370534457}
33706__ai int32x2_t vreinterpret_s32_f16(float16x4_t __p0) {
33707 int32x2_t __ret;
33708 __ret = (int32x2_t)(__p0);
34458#endif
34459
34460#ifdef __LITTLE_ENDIAN__
34461__ai __attribute__((target("fullfp16"))) uint16x4_t vcgt_f16(float16x4_t __p0, float16x4_t __p1) {
34462 uint16x4_t __ret;
34463 __ret = (uint16x4_t)(__p0 > __p1);
3370934464 return __ret;
3371034465}
33711__ai int32x2_t vreinterpret_s32_s64(int64x1_t __p0) {
33712 int32x2_t __ret;
33713 __ret = (int32x2_t)(__p0);
34466#else
34467__ai __attribute__((target("fullfp16"))) uint16x4_t vcgt_f16(float16x4_t __p0, float16x4_t __p1) {
34468 uint16x4_t __ret;
34469 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34470 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
34471 __ret = (uint16x4_t)(__rev0 > __rev1);
34472 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3371434473 return __ret;
3371534474}
33716__ai int32x2_t vreinterpret_s32_s16(int16x4_t __p0) {
33717 int32x2_t __ret;
33718 __ret = (int32x2_t)(__p0);
34475#endif
34476
34477#ifdef __LITTLE_ENDIAN__
34478__ai __attribute__((target("fullfp16"))) uint16x8_t vcgtzq_f16(float16x8_t __p0) {
34479 uint16x8_t __ret;
34480 __ret = (uint16x8_t) __builtin_neon_vcgtzq_f16((int8x16_t)__p0, 49);
3371934481 return __ret;
3372034482}
33721__ai int64x1_t vreinterpret_s64_p8(poly8x8_t __p0) {
33722 int64x1_t __ret;
33723 __ret = (int64x1_t)(__p0);
34483#else
34484__ai __attribute__((target("fullfp16"))) uint16x8_t vcgtzq_f16(float16x8_t __p0) {
34485 uint16x8_t __ret;
34486 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
34487 __ret = (uint16x8_t) __builtin_neon_vcgtzq_f16((int8x16_t)__rev0, 49);
34488 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
3372434489 return __ret;
3372534490}
33726__ai int64x1_t vreinterpret_s64_p16(poly16x4_t __p0) {
33727 int64x1_t __ret;
33728 __ret = (int64x1_t)(__p0);
34491#endif
34492
34493#ifdef __LITTLE_ENDIAN__
34494__ai __attribute__((target("fullfp16"))) uint16x4_t vcgtz_f16(float16x4_t __p0) {
34495 uint16x4_t __ret;
34496 __ret = (uint16x4_t) __builtin_neon_vcgtz_f16((int8x8_t)__p0, 17);
3372934497 return __ret;
3373034498}
33731__ai int64x1_t vreinterpret_s64_u8(uint8x8_t __p0) {
33732 int64x1_t __ret;
33733 __ret = (int64x1_t)(__p0);
34499#else
34500__ai __attribute__((target("fullfp16"))) uint16x4_t vcgtz_f16(float16x4_t __p0) {
34501 uint16x4_t __ret;
34502 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34503 __ret = (uint16x4_t) __builtin_neon_vcgtz_f16((int8x8_t)__rev0, 17);
34504 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3373434505 return __ret;
3373534506}
33736__ai int64x1_t vreinterpret_s64_u32(uint32x2_t __p0) {
33737 int64x1_t __ret;
33738 __ret = (int64x1_t)(__p0);
34507#endif
34508
34509#ifdef __LITTLE_ENDIAN__
34510__ai __attribute__((target("fullfp16"))) uint16x8_t vcleq_f16(float16x8_t __p0, float16x8_t __p1) {
34511 uint16x8_t __ret;
34512 __ret = (uint16x8_t)(__p0 <= __p1);
3373934513 return __ret;
3374034514}
33741__ai int64x1_t vreinterpret_s64_u64(uint64x1_t __p0) {
33742 int64x1_t __ret;
33743 __ret = (int64x1_t)(__p0);
34515#else
34516__ai __attribute__((target("fullfp16"))) uint16x8_t vcleq_f16(float16x8_t __p0, float16x8_t __p1) {
34517 uint16x8_t __ret;
34518 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
34519 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
34520 __ret = (uint16x8_t)(__rev0 <= __rev1);
34521 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
3374434522 return __ret;
3374534523}
33746__ai int64x1_t vreinterpret_s64_u16(uint16x4_t __p0) {
33747 int64x1_t __ret;
33748 __ret = (int64x1_t)(__p0);
34524#endif
34525
34526#ifdef __LITTLE_ENDIAN__
34527__ai __attribute__((target("fullfp16"))) uint16x4_t vcle_f16(float16x4_t __p0, float16x4_t __p1) {
34528 uint16x4_t __ret;
34529 __ret = (uint16x4_t)(__p0 <= __p1);
34530 return __ret;
34531}
34532#else
34533__ai __attribute__((target("fullfp16"))) uint16x4_t vcle_f16(float16x4_t __p0, float16x4_t __p1) {
34534 uint16x4_t __ret;
34535 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34536 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
34537 __ret = (uint16x4_t)(__rev0 <= __rev1);
34538 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3374934539 return __ret;
3375034540}
33751__ai int64x1_t vreinterpret_s64_s8(int8x8_t __p0) {
33752 int64x1_t __ret;
33753 __ret = (int64x1_t)(__p0);
34541#endif
34542
34543#ifdef __LITTLE_ENDIAN__
34544__ai __attribute__((target("fullfp16"))) uint16x8_t vclezq_f16(float16x8_t __p0) {
34545 uint16x8_t __ret;
34546 __ret = (uint16x8_t) __builtin_neon_vclezq_f16((int8x16_t)__p0, 49);
3375434547 return __ret;
3375534548}
33756__ai int64x1_t vreinterpret_s64_f32(float32x2_t __p0) {
33757 int64x1_t __ret;
33758 __ret = (int64x1_t)(__p0);
34549#else
34550__ai __attribute__((target("fullfp16"))) uint16x8_t vclezq_f16(float16x8_t __p0) {
34551 uint16x8_t __ret;
34552 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
34553 __ret = (uint16x8_t) __builtin_neon_vclezq_f16((int8x16_t)__rev0, 49);
34554 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
3375934555 return __ret;
3376034556}
33761__ai int64x1_t vreinterpret_s64_f16(float16x4_t __p0) {
33762 int64x1_t __ret;
33763 __ret = (int64x1_t)(__p0);
34557#endif
34558
34559#ifdef __LITTLE_ENDIAN__
34560__ai __attribute__((target("fullfp16"))) uint16x4_t vclez_f16(float16x4_t __p0) {
34561 uint16x4_t __ret;
34562 __ret = (uint16x4_t) __builtin_neon_vclez_f16((int8x8_t)__p0, 17);
3376434563 return __ret;
3376534564}
33766__ai int64x1_t vreinterpret_s64_s32(int32x2_t __p0) {
33767 int64x1_t __ret;
33768 __ret = (int64x1_t)(__p0);
34565#else
34566__ai __attribute__((target("fullfp16"))) uint16x4_t vclez_f16(float16x4_t __p0) {
34567 uint16x4_t __ret;
34568 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34569 __ret = (uint16x4_t) __builtin_neon_vclez_f16((int8x8_t)__rev0, 17);
34570 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3376934571 return __ret;
3377034572}
33771__ai int64x1_t vreinterpret_s64_s16(int16x4_t __p0) {
33772 int64x1_t __ret;
33773 __ret = (int64x1_t)(__p0);
34573#endif
34574
34575#ifdef __LITTLE_ENDIAN__
34576__ai __attribute__((target("fullfp16"))) uint16x8_t vcltq_f16(float16x8_t __p0, float16x8_t __p1) {
34577 uint16x8_t __ret;
34578 __ret = (uint16x8_t)(__p0 < __p1);
3377434579 return __ret;
3377534580}
33776__ai int16x4_t vreinterpret_s16_p8(poly8x8_t __p0) {
33777 int16x4_t __ret;
33778 __ret = (int16x4_t)(__p0);
34581#else
34582__ai __attribute__((target("fullfp16"))) uint16x8_t vcltq_f16(float16x8_t __p0, float16x8_t __p1) {
34583 uint16x8_t __ret;
34584 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
34585 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
34586 __ret = (uint16x8_t)(__rev0 < __rev1);
34587 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
3377934588 return __ret;
3378034589}
33781__ai int16x4_t vreinterpret_s16_p16(poly16x4_t __p0) {
33782 int16x4_t __ret;
33783 __ret = (int16x4_t)(__p0);
34590#endif
34591
34592#ifdef __LITTLE_ENDIAN__
34593__ai __attribute__((target("fullfp16"))) uint16x4_t vclt_f16(float16x4_t __p0, float16x4_t __p1) {
34594 uint16x4_t __ret;
34595 __ret = (uint16x4_t)(__p0 < __p1);
3378434596 return __ret;
3378534597}
33786__ai int16x4_t vreinterpret_s16_u8(uint8x8_t __p0) {
33787 int16x4_t __ret;
33788 __ret = (int16x4_t)(__p0);
34598#else
34599__ai __attribute__((target("fullfp16"))) uint16x4_t vclt_f16(float16x4_t __p0, float16x4_t __p1) {
34600 uint16x4_t __ret;
34601 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34602 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
34603 __ret = (uint16x4_t)(__rev0 < __rev1);
34604 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3378934605 return __ret;
3379034606}
33791__ai int16x4_t vreinterpret_s16_u32(uint32x2_t __p0) {
33792 int16x4_t __ret;
33793 __ret = (int16x4_t)(__p0);
34607#endif
34608
34609#ifdef __LITTLE_ENDIAN__
34610__ai __attribute__((target("fullfp16"))) uint16x8_t vcltzq_f16(float16x8_t __p0) {
34611 uint16x8_t __ret;
34612 __ret = (uint16x8_t) __builtin_neon_vcltzq_f16((int8x16_t)__p0, 49);
3379434613 return __ret;
3379534614}
33796__ai int16x4_t vreinterpret_s16_u64(uint64x1_t __p0) {
33797 int16x4_t __ret;
33798 __ret = (int16x4_t)(__p0);
34615#else
34616__ai __attribute__((target("fullfp16"))) uint16x8_t vcltzq_f16(float16x8_t __p0) {
34617 uint16x8_t __ret;
34618 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
34619 __ret = (uint16x8_t) __builtin_neon_vcltzq_f16((int8x16_t)__rev0, 49);
34620 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
3379934621 return __ret;
3380034622}
33801__ai int16x4_t vreinterpret_s16_u16(uint16x4_t __p0) {
33802 int16x4_t __ret;
33803 __ret = (int16x4_t)(__p0);
34623#endif
34624
34625#ifdef __LITTLE_ENDIAN__
34626__ai __attribute__((target("fullfp16"))) uint16x4_t vcltz_f16(float16x4_t __p0) {
34627 uint16x4_t __ret;
34628 __ret = (uint16x4_t) __builtin_neon_vcltz_f16((int8x8_t)__p0, 17);
3380434629 return __ret;
3380534630}
33806__ai int16x4_t vreinterpret_s16_s8(int8x8_t __p0) {
33807 int16x4_t __ret;
33808 __ret = (int16x4_t)(__p0);
34631#else
34632__ai __attribute__((target("fullfp16"))) uint16x4_t vcltz_f16(float16x4_t __p0) {
34633 uint16x4_t __ret;
34634 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34635 __ret = (uint16x4_t) __builtin_neon_vcltz_f16((int8x8_t)__rev0, 17);
34636 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3380934637 return __ret;
3381034638}
33811__ai int16x4_t vreinterpret_s16_f32(float32x2_t __p0) {
33812 int16x4_t __ret;
33813 __ret = (int16x4_t)(__p0);
34639#endif
34640
34641#ifdef __LITTLE_ENDIAN__
34642__ai __attribute__((target("fullfp16"))) float16x8_t vcvtq_f16_u16(uint16x8_t __p0) {
34643 float16x8_t __ret;
34644 __ret = (float16x8_t) __builtin_neon_vcvtq_f16_u16((int8x16_t)__p0, 49);
3381434645 return __ret;
3381534646}
33816__ai int16x4_t vreinterpret_s16_f16(float16x4_t __p0) {
33817 int16x4_t __ret;
33818 __ret = (int16x4_t)(__p0);
34647#else
34648__ai __attribute__((target("fullfp16"))) float16x8_t vcvtq_f16_u16(uint16x8_t __p0) {
34649 float16x8_t __ret;
34650 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
34651 __ret = (float16x8_t) __builtin_neon_vcvtq_f16_u16((int8x16_t)__rev0, 49);
34652 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
3381934653 return __ret;
3382034654}
33821__ai int16x4_t vreinterpret_s16_s32(int32x2_t __p0) {
33822 int16x4_t __ret;
33823 __ret = (int16x4_t)(__p0);
34655#endif
34656
34657#ifdef __LITTLE_ENDIAN__
34658__ai __attribute__((target("fullfp16"))) float16x8_t vcvtq_f16_s16(int16x8_t __p0) {
34659 float16x8_t __ret;
34660 __ret = (float16x8_t) __builtin_neon_vcvtq_f16_s16((int8x16_t)__p0, 33);
3382434661 return __ret;
3382534662}
33826__ai int16x4_t vreinterpret_s16_s64(int64x1_t __p0) {
33827 int16x4_t __ret;
33828 __ret = (int16x4_t)(__p0);
34663#else
34664__ai __attribute__((target("fullfp16"))) float16x8_t vcvtq_f16_s16(int16x8_t __p0) {
34665 float16x8_t __ret;
34666 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
34667 __ret = (float16x8_t) __builtin_neon_vcvtq_f16_s16((int8x16_t)__rev0, 33);
34668 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
3382934669 return __ret;
3383034670}
3383134671#endif
33832#if (__ARM_FP & 2)
34672
3383334673#ifdef __LITTLE_ENDIAN__
33834__ai float16x4_t vcvt_f16_f32(float32x4_t __p0) {
34674__ai __attribute__((target("fullfp16"))) float16x4_t vcvt_f16_u16(uint16x4_t __p0) {
3383534675 float16x4_t __ret;
33836 __ret = (float16x4_t) __builtin_neon_vcvt_f16_f32((int8x16_t)__p0, 41);
34676 __ret = (float16x4_t) __builtin_neon_vcvt_f16_u16((int8x8_t)__p0, 17);
3383734677 return __ret;
3383834678}
3383934679#else
33840__ai float16x4_t vcvt_f16_f32(float32x4_t __p0) {
34680__ai __attribute__((target("fullfp16"))) float16x4_t vcvt_f16_u16(uint16x4_t __p0) {
3384134681 float16x4_t __ret;
33842 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
33843 __ret = (float16x4_t) __builtin_neon_vcvt_f16_f32((int8x16_t)__rev0, 41);
34682 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34683 __ret = (float16x4_t) __builtin_neon_vcvt_f16_u16((int8x8_t)__rev0, 17);
3384434684 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3384534685 return __ret;
3384634686}
33847__ai float16x4_t __noswap_vcvt_f16_f32(float32x4_t __p0) {
33848 float16x4_t __ret;
33849 __ret = (float16x4_t) __builtin_neon_vcvt_f16_f32((int8x16_t)__p0, 41);
33850 return __ret;
33851}
3385234687#endif
3385334688
3385434689#ifdef __LITTLE_ENDIAN__
33855__ai float32x4_t vcvt_f32_f16(float16x4_t __p0) {
33856 float32x4_t __ret;
33857 __ret = (float32x4_t) __builtin_neon_vcvt_f32_f16((int8x8_t)__p0, 8);
34690__ai __attribute__((target("fullfp16"))) float16x4_t vcvt_f16_s16(int16x4_t __p0) {
34691 float16x4_t __ret;
34692 __ret = (float16x4_t) __builtin_neon_vcvt_f16_s16((int8x8_t)__p0, 1);
3385834693 return __ret;
3385934694}
3386034695#else
33861__ai float32x4_t vcvt_f32_f16(float16x4_t __p0) {
33862 float32x4_t __ret;
33863 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
33864 __ret = (float32x4_t) __builtin_neon_vcvt_f32_f16((int8x8_t)__rev0, 8);
34696__ai __attribute__((target("fullfp16"))) float16x4_t vcvt_f16_s16(int16x4_t __p0) {
34697 float16x4_t __ret;
34698 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34699 __ret = (float16x4_t) __builtin_neon_vcvt_f16_s16((int8x8_t)__rev0, 1);
3386534700 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3386634701 return __ret;
3386734702}
33868__ai float32x4_t __noswap_vcvt_f32_f16(float16x4_t __p0) {
33869 float32x4_t __ret;
33870 __ret = (float32x4_t) __builtin_neon_vcvt_f32_f16((int8x8_t)__p0, 8);
33871 return __ret;
33872}
3387334703#endif
3387434704
3387534705#ifdef __LITTLE_ENDIAN__
33876#define vld1q_f16(__p0) __extension__ ({ \
34706#define vcvtq_n_f16_u16(__p0, __p1) __extension__ ({ \
3387734707 float16x8_t __ret; \
33878 __ret = (float16x8_t) __builtin_neon_vld1q_v(__p0, 40); \
34708 uint16x8_t __s0 = __p0; \
34709 __ret = (float16x8_t) __builtin_neon_vcvtq_n_f16_u16((int8x16_t)__s0, __p1, 49); \
3387934710 __ret; \
3388034711})
3388134712#else
33882#define vld1q_f16(__p0) __extension__ ({ \
34713#define vcvtq_n_f16_u16(__p0, __p1) __extension__ ({ \
3388334714 float16x8_t __ret; \
33884 __ret = (float16x8_t) __builtin_neon_vld1q_v(__p0, 40); \
34715 uint16x8_t __s0 = __p0; \
34716 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
34717 __ret = (float16x8_t) __builtin_neon_vcvtq_n_f16_u16((int8x16_t)__rev0, __p1, 49); \
3388534718 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
3388634719 __ret; \
3388734720})
3388834721#endif
3388934722
3389034723#ifdef __LITTLE_ENDIAN__
33891#define vld1_f16(__p0) __extension__ ({ \
33892 float16x4_t __ret; \
33893 __ret = (float16x4_t) __builtin_neon_vld1_v(__p0, 8); \
34724#define vcvtq_n_f16_s16(__p0, __p1) __extension__ ({ \
34725 float16x8_t __ret; \
34726 int16x8_t __s0 = __p0; \
34727 __ret = (float16x8_t) __builtin_neon_vcvtq_n_f16_s16((int8x16_t)__s0, __p1, 33); \
3389434728 __ret; \
3389534729})
3389634730#else
33897#define vld1_f16(__p0) __extension__ ({ \
33898 float16x4_t __ret; \
33899 __ret = (float16x4_t) __builtin_neon_vld1_v(__p0, 8); \
33900 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
34731#define vcvtq_n_f16_s16(__p0, __p1) __extension__ ({ \
34732 float16x8_t __ret; \
34733 int16x8_t __s0 = __p0; \
34734 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
34735 __ret = (float16x8_t) __builtin_neon_vcvtq_n_f16_s16((int8x16_t)__rev0, __p1, 33); \
34736 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
3390134737 __ret; \
3390234738})
3390334739#endif
3390434740
3390534741#ifdef __LITTLE_ENDIAN__
33906#define vld1q_dup_f16(__p0) __extension__ ({ \
33907 float16x8_t __ret; \
33908 __ret = (float16x8_t) __builtin_neon_vld1q_dup_v(__p0, 40); \
34742#define vcvt_n_f16_u16(__p0, __p1) __extension__ ({ \
34743 float16x4_t __ret; \
34744 uint16x4_t __s0 = __p0; \
34745 __ret = (float16x4_t) __builtin_neon_vcvt_n_f16_u16((int8x8_t)__s0, __p1, 17); \
3390934746 __ret; \
3391034747})
3391134748#else
33912#define vld1q_dup_f16(__p0) __extension__ ({ \
33913 float16x8_t __ret; \
33914 __ret = (float16x8_t) __builtin_neon_vld1q_dup_v(__p0, 40); \
33915 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
34749#define vcvt_n_f16_u16(__p0, __p1) __extension__ ({ \
34750 float16x4_t __ret; \
34751 uint16x4_t __s0 = __p0; \
34752 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
34753 __ret = (float16x4_t) __builtin_neon_vcvt_n_f16_u16((int8x8_t)__rev0, __p1, 17); \
34754 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
3391634755 __ret; \
3391734756})
3391834757#endif
3391934758
3392034759#ifdef __LITTLE_ENDIAN__
33921#define vld1_dup_f16(__p0) __extension__ ({ \
34760#define vcvt_n_f16_s16(__p0, __p1) __extension__ ({ \
3392234761 float16x4_t __ret; \
33923 __ret = (float16x4_t) __builtin_neon_vld1_dup_v(__p0, 8); \
34762 int16x4_t __s0 = __p0; \
34763 __ret = (float16x4_t) __builtin_neon_vcvt_n_f16_s16((int8x8_t)__s0, __p1, 1); \
3392434764 __ret; \
3392534765})
3392634766#else
33927#define vld1_dup_f16(__p0) __extension__ ({ \
34767#define vcvt_n_f16_s16(__p0, __p1) __extension__ ({ \
3392834768 float16x4_t __ret; \
33929 __ret = (float16x4_t) __builtin_neon_vld1_dup_v(__p0, 8); \
34769 int16x4_t __s0 = __p0; \
34770 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
34771 __ret = (float16x4_t) __builtin_neon_vcvt_n_f16_s16((int8x8_t)__rev0, __p1, 1); \
3393034772 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
3393134773 __ret; \
3393234774})
3393334775#endif
3393434776
3393534777#ifdef __LITTLE_ENDIAN__
33936#define vld1q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
33937 float16x8_t __ret; \
33938 float16x8_t __s1 = __p1; \
33939 __ret = (float16x8_t) __builtin_neon_vld1q_lane_v(__p0, (int8x16_t)__s1, __p2, 40); \
34778#define vcvtq_n_s16_f16(__p0, __p1) __extension__ ({ \
34779 int16x8_t __ret; \
34780 float16x8_t __s0 = __p0; \
34781 __ret = (int16x8_t) __builtin_neon_vcvtq_n_s16_f16((int8x16_t)__s0, __p1, 33); \
3394034782 __ret; \
3394134783})
3394234784#else
33943#define vld1q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
33944 float16x8_t __ret; \
33945 float16x8_t __s1 = __p1; \
33946 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
33947 __ret = (float16x8_t) __builtin_neon_vld1q_lane_v(__p0, (int8x16_t)__rev1, __p2, 40); \
34785#define vcvtq_n_s16_f16(__p0, __p1) __extension__ ({ \
34786 int16x8_t __ret; \
34787 float16x8_t __s0 = __p0; \
34788 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
34789 __ret = (int16x8_t) __builtin_neon_vcvtq_n_s16_f16((int8x16_t)__rev0, __p1, 33); \
3394834790 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
3394934791 __ret; \
3395034792})
3395134793#endif
3395234794
3395334795#ifdef __LITTLE_ENDIAN__
33954#define vld1_lane_f16(__p0, __p1, __p2) __extension__ ({ \
33955 float16x4_t __ret; \
33956 float16x4_t __s1 = __p1; \
33957 __ret = (float16x4_t) __builtin_neon_vld1_lane_v(__p0, (int8x8_t)__s1, __p2, 8); \
34796#define vcvt_n_s16_f16(__p0, __p1) __extension__ ({ \
34797 int16x4_t __ret; \
34798 float16x4_t __s0 = __p0; \
34799 __ret = (int16x4_t) __builtin_neon_vcvt_n_s16_f16((int8x8_t)__s0, __p1, 1); \
3395834800 __ret; \
3395934801})
3396034802#else
33961#define vld1_lane_f16(__p0, __p1, __p2) __extension__ ({ \
33962 float16x4_t __ret; \
33963 float16x4_t __s1 = __p1; \
33964 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
33965 __ret = (float16x4_t) __builtin_neon_vld1_lane_v(__p0, (int8x8_t)__rev1, __p2, 8); \
34803#define vcvt_n_s16_f16(__p0, __p1) __extension__ ({ \
34804 int16x4_t __ret; \
34805 float16x4_t __s0 = __p0; \
34806 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
34807 __ret = (int16x4_t) __builtin_neon_vcvt_n_s16_f16((int8x8_t)__rev0, __p1, 1); \
3396634808 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
3396734809 __ret; \
3396834810})
3396934811#endif
3397034812
3397134813#ifdef __LITTLE_ENDIAN__
33972#define vld1q_f16_x2(__p0) __extension__ ({ \
33973 float16x8x2_t __ret; \
33974 __builtin_neon_vld1q_x2_v(&__ret, __p0, 40); \
34814#define vcvtq_n_u16_f16(__p0, __p1) __extension__ ({ \
34815 uint16x8_t __ret; \
34816 float16x8_t __s0 = __p0; \
34817 __ret = (uint16x8_t) __builtin_neon_vcvtq_n_u16_f16((int8x16_t)__s0, __p1, 49); \
3397534818 __ret; \
3397634819})
3397734820#else
33978#define vld1q_f16_x2(__p0) __extension__ ({ \
33979 float16x8x2_t __ret; \
33980 __builtin_neon_vld1q_x2_v(&__ret, __p0, 40); \
33981 \
33982 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
33983 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
34821#define vcvtq_n_u16_f16(__p0, __p1) __extension__ ({ \
34822 uint16x8_t __ret; \
34823 float16x8_t __s0 = __p0; \
34824 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
34825 __ret = (uint16x8_t) __builtin_neon_vcvtq_n_u16_f16((int8x16_t)__rev0, __p1, 49); \
34826 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
3398434827 __ret; \
3398534828})
3398634829#endif
3398734830
3398834831#ifdef __LITTLE_ENDIAN__
33989#define vld1_f16_x2(__p0) __extension__ ({ \
33990 float16x4x2_t __ret; \
33991 __builtin_neon_vld1_x2_v(&__ret, __p0, 8); \
34832#define vcvt_n_u16_f16(__p0, __p1) __extension__ ({ \
34833 uint16x4_t __ret; \
34834 float16x4_t __s0 = __p0; \
34835 __ret = (uint16x4_t) __builtin_neon_vcvt_n_u16_f16((int8x8_t)__s0, __p1, 17); \
3399234836 __ret; \
3399334837})
3399434838#else
33995#define vld1_f16_x2(__p0) __extension__ ({ \
33996 float16x4x2_t __ret; \
33997 __builtin_neon_vld1_x2_v(&__ret, __p0, 8); \
33998 \
33999 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
34000 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
34839#define vcvt_n_u16_f16(__p0, __p1) __extension__ ({ \
34840 uint16x4_t __ret; \
34841 float16x4_t __s0 = __p0; \
34842 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
34843 __ret = (uint16x4_t) __builtin_neon_vcvt_n_u16_f16((int8x8_t)__rev0, __p1, 17); \
34844 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
3400134845 __ret; \
3400234846})
3400334847#endif
3400434848
3400534849#ifdef __LITTLE_ENDIAN__
34006#define vld1q_f16_x3(__p0) __extension__ ({ \
34007 float16x8x3_t __ret; \
34008 __builtin_neon_vld1q_x3_v(&__ret, __p0, 40); \
34009 __ret; \
34010})
34850__ai __attribute__((target("fullfp16"))) int16x8_t vcvtq_s16_f16(float16x8_t __p0) {
34851 int16x8_t __ret;
34852 __ret = (int16x8_t) __builtin_neon_vcvtq_s16_f16((int8x16_t)__p0, 33);
34853 return __ret;
34854}
3401134855#else
34012#define vld1q_f16_x3(__p0) __extension__ ({ \
34013 float16x8x3_t __ret; \
34014 __builtin_neon_vld1q_x3_v(&__ret, __p0, 40); \
34015 \
34016 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
34017 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
34018 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
34019 __ret; \
34020})
34856__ai __attribute__((target("fullfp16"))) int16x8_t vcvtq_s16_f16(float16x8_t __p0) {
34857 int16x8_t __ret;
34858 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
34859 __ret = (int16x8_t) __builtin_neon_vcvtq_s16_f16((int8x16_t)__rev0, 33);
34860 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
34861 return __ret;
34862}
3402134863#endif
3402234864
3402334865#ifdef __LITTLE_ENDIAN__
34024#define vld1_f16_x3(__p0) __extension__ ({ \
34025 float16x4x3_t __ret; \
34026 __builtin_neon_vld1_x3_v(&__ret, __p0, 8); \
34027 __ret; \
34028})
34866__ai __attribute__((target("fullfp16"))) int16x4_t vcvt_s16_f16(float16x4_t __p0) {
34867 int16x4_t __ret;
34868 __ret = (int16x4_t) __builtin_neon_vcvt_s16_f16((int8x8_t)__p0, 1);
34869 return __ret;
34870}
3402934871#else
34030#define vld1_f16_x3(__p0) __extension__ ({ \
34031 float16x4x3_t __ret; \
34032 __builtin_neon_vld1_x3_v(&__ret, __p0, 8); \
34033 \
34034 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
34035 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
34036 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
34037 __ret; \
34038})
34872__ai __attribute__((target("fullfp16"))) int16x4_t vcvt_s16_f16(float16x4_t __p0) {
34873 int16x4_t __ret;
34874 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34875 __ret = (int16x4_t) __builtin_neon_vcvt_s16_f16((int8x8_t)__rev0, 1);
34876 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
34877 return __ret;
34878}
3403934879#endif
3404034880
3404134881#ifdef __LITTLE_ENDIAN__
34042#define vld1q_f16_x4(__p0) __extension__ ({ \
34043 float16x8x4_t __ret; \
34044 __builtin_neon_vld1q_x4_v(&__ret, __p0, 40); \
34045 __ret; \
34046})
34882__ai __attribute__((target("fullfp16"))) uint16x8_t vcvtq_u16_f16(float16x8_t __p0) {
34883 uint16x8_t __ret;
34884 __ret = (uint16x8_t) __builtin_neon_vcvtq_u16_f16((int8x16_t)__p0, 49);
34885 return __ret;
34886}
3404734887#else
34048#define vld1q_f16_x4(__p0) __extension__ ({ \
34049 float16x8x4_t __ret; \
34050 __builtin_neon_vld1q_x4_v(&__ret, __p0, 40); \
34051 \
34052 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
34053 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
34054 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
34055 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
34056 __ret; \
34057})
34888__ai __attribute__((target("fullfp16"))) uint16x8_t vcvtq_u16_f16(float16x8_t __p0) {
34889 uint16x8_t __ret;
34890 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
34891 __ret = (uint16x8_t) __builtin_neon_vcvtq_u16_f16((int8x16_t)__rev0, 49);
34892 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
34893 return __ret;
34894}
3405834895#endif
3405934896
3406034897#ifdef __LITTLE_ENDIAN__
34061#define vld1_f16_x4(__p0) __extension__ ({ \
34062 float16x4x4_t __ret; \
34063 __builtin_neon_vld1_x4_v(&__ret, __p0, 8); \
34064 __ret; \
34065})
34898__ai __attribute__((target("fullfp16"))) uint16x4_t vcvt_u16_f16(float16x4_t __p0) {
34899 uint16x4_t __ret;
34900 __ret = (uint16x4_t) __builtin_neon_vcvt_u16_f16((int8x8_t)__p0, 17);
34901 return __ret;
34902}
3406634903#else
34067#define vld1_f16_x4(__p0) __extension__ ({ \
34068 float16x4x4_t __ret; \
34069 __builtin_neon_vld1_x4_v(&__ret, __p0, 8); \
34070 \
34071 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
34072 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
34073 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
34074 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 3, 2, 1, 0); \
34075 __ret; \
34076})
34904__ai __attribute__((target("fullfp16"))) uint16x4_t vcvt_u16_f16(float16x4_t __p0) {
34905 uint16x4_t __ret;
34906 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34907 __ret = (uint16x4_t) __builtin_neon_vcvt_u16_f16((int8x8_t)__rev0, 17);
34908 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
34909 return __ret;
34910}
3407734911#endif
3407834912
3407934913#ifdef __LITTLE_ENDIAN__
34080#define vld2q_f16(__p0) __extension__ ({ \
34081 float16x8x2_t __ret; \
34082 __builtin_neon_vld2q_v(&__ret, __p0, 40); \
34083 __ret; \
34084})
34914__ai __attribute__((target("fullfp16"))) int16x8_t vcvtaq_s16_f16(float16x8_t __p0) {
34915 int16x8_t __ret;
34916 __ret = (int16x8_t) __builtin_neon_vcvtaq_s16_f16((int8x16_t)__p0, 33);
34917 return __ret;
34918}
3408534919#else
34086#define vld2q_f16(__p0) __extension__ ({ \
34087 float16x8x2_t __ret; \
34088 __builtin_neon_vld2q_v(&__ret, __p0, 40); \
34089 \
34090 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
34091 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
34092 __ret; \
34093})
34920__ai __attribute__((target("fullfp16"))) int16x8_t vcvtaq_s16_f16(float16x8_t __p0) {
34921 int16x8_t __ret;
34922 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
34923 __ret = (int16x8_t) __builtin_neon_vcvtaq_s16_f16((int8x16_t)__rev0, 33);
34924 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
34925 return __ret;
34926}
3409434927#endif
3409534928
3409634929#ifdef __LITTLE_ENDIAN__
34097#define vld2_f16(__p0) __extension__ ({ \
34098 float16x4x2_t __ret; \
34099 __builtin_neon_vld2_v(&__ret, __p0, 8); \
34100 __ret; \
34101})
34930__ai __attribute__((target("fullfp16"))) int16x4_t vcvta_s16_f16(float16x4_t __p0) {
34931 int16x4_t __ret;
34932 __ret = (int16x4_t) __builtin_neon_vcvta_s16_f16((int8x8_t)__p0, 1);
34933 return __ret;
34934}
3410234935#else
34103#define vld2_f16(__p0) __extension__ ({ \
34104 float16x4x2_t __ret; \
34105 __builtin_neon_vld2_v(&__ret, __p0, 8); \
34106 \
34107 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
34108 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
34109 __ret; \
34110})
34936__ai __attribute__((target("fullfp16"))) int16x4_t vcvta_s16_f16(float16x4_t __p0) {
34937 int16x4_t __ret;
34938 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34939 __ret = (int16x4_t) __builtin_neon_vcvta_s16_f16((int8x8_t)__rev0, 1);
34940 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
34941 return __ret;
34942}
3411134943#endif
3411234944
3411334945#ifdef __LITTLE_ENDIAN__
34114#define vld2q_dup_f16(__p0) __extension__ ({ \
34115 float16x8x2_t __ret; \
34116 __builtin_neon_vld2q_dup_v(&__ret, __p0, 40); \
34117 __ret; \
34118})
34946__ai __attribute__((target("fullfp16"))) uint16x8_t vcvtaq_u16_f16(float16x8_t __p0) {
34947 uint16x8_t __ret;
34948 __ret = (uint16x8_t) __builtin_neon_vcvtaq_u16_f16((int8x16_t)__p0, 49);
34949 return __ret;
34950}
3411934951#else
34120#define vld2q_dup_f16(__p0) __extension__ ({ \
34121 float16x8x2_t __ret; \
34122 __builtin_neon_vld2q_dup_v(&__ret, __p0, 40); \
34123 \
34124 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
34125 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
34126 __ret; \
34127})
34952__ai __attribute__((target("fullfp16"))) uint16x8_t vcvtaq_u16_f16(float16x8_t __p0) {
34953 uint16x8_t __ret;
34954 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
34955 __ret = (uint16x8_t) __builtin_neon_vcvtaq_u16_f16((int8x16_t)__rev0, 49);
34956 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
34957 return __ret;
34958}
3412834959#endif
3412934960
3413034961#ifdef __LITTLE_ENDIAN__
34131#define vld2_dup_f16(__p0) __extension__ ({ \
34132 float16x4x2_t __ret; \
34133 __builtin_neon_vld2_dup_v(&__ret, __p0, 8); \
34134 __ret; \
34135})
34962__ai __attribute__((target("fullfp16"))) uint16x4_t vcvta_u16_f16(float16x4_t __p0) {
34963 uint16x4_t __ret;
34964 __ret = (uint16x4_t) __builtin_neon_vcvta_u16_f16((int8x8_t)__p0, 17);
34965 return __ret;
34966}
34967#else
34968__ai __attribute__((target("fullfp16"))) uint16x4_t vcvta_u16_f16(float16x4_t __p0) {
34969 uint16x4_t __ret;
34970 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34971 __ret = (uint16x4_t) __builtin_neon_vcvta_u16_f16((int8x8_t)__rev0, 17);
34972 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
34973 return __ret;
34974}
34975#endif
34976
34977#ifdef __LITTLE_ENDIAN__
34978__ai __attribute__((target("fullfp16"))) int16x8_t vcvtmq_s16_f16(float16x8_t __p0) {
34979 int16x8_t __ret;
34980 __ret = (int16x8_t) __builtin_neon_vcvtmq_s16_f16((int8x16_t)__p0, 33);
34981 return __ret;
34982}
34983#else
34984__ai __attribute__((target("fullfp16"))) int16x8_t vcvtmq_s16_f16(float16x8_t __p0) {
34985 int16x8_t __ret;
34986 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
34987 __ret = (int16x8_t) __builtin_neon_vcvtmq_s16_f16((int8x16_t)__rev0, 33);
34988 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
34989 return __ret;
34990}
34991#endif
34992
34993#ifdef __LITTLE_ENDIAN__
34994__ai __attribute__((target("fullfp16"))) int16x4_t vcvtm_s16_f16(float16x4_t __p0) {
34995 int16x4_t __ret;
34996 __ret = (int16x4_t) __builtin_neon_vcvtm_s16_f16((int8x8_t)__p0, 1);
34997 return __ret;
34998}
34999#else
35000__ai __attribute__((target("fullfp16"))) int16x4_t vcvtm_s16_f16(float16x4_t __p0) {
35001 int16x4_t __ret;
35002 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35003 __ret = (int16x4_t) __builtin_neon_vcvtm_s16_f16((int8x8_t)__rev0, 1);
35004 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35005 return __ret;
35006}
35007#endif
35008
35009#ifdef __LITTLE_ENDIAN__
35010__ai __attribute__((target("fullfp16"))) uint16x8_t vcvtmq_u16_f16(float16x8_t __p0) {
35011 uint16x8_t __ret;
35012 __ret = (uint16x8_t) __builtin_neon_vcvtmq_u16_f16((int8x16_t)__p0, 49);
35013 return __ret;
35014}
35015#else
35016__ai __attribute__((target("fullfp16"))) uint16x8_t vcvtmq_u16_f16(float16x8_t __p0) {
35017 uint16x8_t __ret;
35018 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35019 __ret = (uint16x8_t) __builtin_neon_vcvtmq_u16_f16((int8x16_t)__rev0, 49);
35020 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
35021 return __ret;
35022}
35023#endif
35024
35025#ifdef __LITTLE_ENDIAN__
35026__ai __attribute__((target("fullfp16"))) uint16x4_t vcvtm_u16_f16(float16x4_t __p0) {
35027 uint16x4_t __ret;
35028 __ret = (uint16x4_t) __builtin_neon_vcvtm_u16_f16((int8x8_t)__p0, 17);
35029 return __ret;
35030}
35031#else
35032__ai __attribute__((target("fullfp16"))) uint16x4_t vcvtm_u16_f16(float16x4_t __p0) {
35033 uint16x4_t __ret;
35034 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35035 __ret = (uint16x4_t) __builtin_neon_vcvtm_u16_f16((int8x8_t)__rev0, 17);
35036 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35037 return __ret;
35038}
35039#endif
35040
35041#ifdef __LITTLE_ENDIAN__
35042__ai __attribute__((target("fullfp16"))) int16x8_t vcvtnq_s16_f16(float16x8_t __p0) {
35043 int16x8_t __ret;
35044 __ret = (int16x8_t) __builtin_neon_vcvtnq_s16_f16((int8x16_t)__p0, 33);
35045 return __ret;
35046}
35047#else
35048__ai __attribute__((target("fullfp16"))) int16x8_t vcvtnq_s16_f16(float16x8_t __p0) {
35049 int16x8_t __ret;
35050 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35051 __ret = (int16x8_t) __builtin_neon_vcvtnq_s16_f16((int8x16_t)__rev0, 33);
35052 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
35053 return __ret;
35054}
35055#endif
35056
35057#ifdef __LITTLE_ENDIAN__
35058__ai __attribute__((target("fullfp16"))) int16x4_t vcvtn_s16_f16(float16x4_t __p0) {
35059 int16x4_t __ret;
35060 __ret = (int16x4_t) __builtin_neon_vcvtn_s16_f16((int8x8_t)__p0, 1);
35061 return __ret;
35062}
35063#else
35064__ai __attribute__((target("fullfp16"))) int16x4_t vcvtn_s16_f16(float16x4_t __p0) {
35065 int16x4_t __ret;
35066 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35067 __ret = (int16x4_t) __builtin_neon_vcvtn_s16_f16((int8x8_t)__rev0, 1);
35068 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35069 return __ret;
35070}
35071#endif
35072
35073#ifdef __LITTLE_ENDIAN__
35074__ai __attribute__((target("fullfp16"))) uint16x8_t vcvtnq_u16_f16(float16x8_t __p0) {
35075 uint16x8_t __ret;
35076 __ret = (uint16x8_t) __builtin_neon_vcvtnq_u16_f16((int8x16_t)__p0, 49);
35077 return __ret;
35078}
35079#else
35080__ai __attribute__((target("fullfp16"))) uint16x8_t vcvtnq_u16_f16(float16x8_t __p0) {
35081 uint16x8_t __ret;
35082 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35083 __ret = (uint16x8_t) __builtin_neon_vcvtnq_u16_f16((int8x16_t)__rev0, 49);
35084 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
35085 return __ret;
35086}
35087#endif
35088
35089#ifdef __LITTLE_ENDIAN__
35090__ai __attribute__((target("fullfp16"))) uint16x4_t vcvtn_u16_f16(float16x4_t __p0) {
35091 uint16x4_t __ret;
35092 __ret = (uint16x4_t) __builtin_neon_vcvtn_u16_f16((int8x8_t)__p0, 17);
35093 return __ret;
35094}
3413635095#else
34137#define vld2_dup_f16(__p0) __extension__ ({ \
34138 float16x4x2_t __ret; \
34139 __builtin_neon_vld2_dup_v(&__ret, __p0, 8); \
34140 \
34141 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
34142 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
34143 __ret; \
34144})
35096__ai __attribute__((target("fullfp16"))) uint16x4_t vcvtn_u16_f16(float16x4_t __p0) {
35097 uint16x4_t __ret;
35098 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35099 __ret = (uint16x4_t) __builtin_neon_vcvtn_u16_f16((int8x8_t)__rev0, 17);
35100 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35101 return __ret;
35102}
3414535103#endif
3414635104
3414735105#ifdef __LITTLE_ENDIAN__
34148#define vld2q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
34149 float16x8x2_t __ret; \
34150 float16x8x2_t __s1 = __p1; \
34151 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 40); \
34152 __ret; \
34153})
35106__ai __attribute__((target("fullfp16"))) int16x8_t vcvtpq_s16_f16(float16x8_t __p0) {
35107 int16x8_t __ret;
35108 __ret = (int16x8_t) __builtin_neon_vcvtpq_s16_f16((int8x16_t)__p0, 33);
35109 return __ret;
35110}
3415435111#else
34155#define vld2q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
34156 float16x8x2_t __ret; \
34157 float16x8x2_t __s1 = __p1; \
34158 float16x8x2_t __rev1; \
34159 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
34160 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
34161 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 40); \
34162 \
34163 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
34164 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
34165 __ret; \
34166})
35112__ai __attribute__((target("fullfp16"))) int16x8_t vcvtpq_s16_f16(float16x8_t __p0) {
35113 int16x8_t __ret;
35114 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35115 __ret = (int16x8_t) __builtin_neon_vcvtpq_s16_f16((int8x16_t)__rev0, 33);
35116 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
35117 return __ret;
35118}
3416735119#endif
3416835120
3416935121#ifdef __LITTLE_ENDIAN__
34170#define vld2_lane_f16(__p0, __p1, __p2) __extension__ ({ \
34171 float16x4x2_t __ret; \
34172 float16x4x2_t __s1 = __p1; \
34173 __builtin_neon_vld2_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], __p2, 8); \
34174 __ret; \
34175})
35122__ai __attribute__((target("fullfp16"))) int16x4_t vcvtp_s16_f16(float16x4_t __p0) {
35123 int16x4_t __ret;
35124 __ret = (int16x4_t) __builtin_neon_vcvtp_s16_f16((int8x8_t)__p0, 1);
35125 return __ret;
35126}
3417635127#else
34177#define vld2_lane_f16(__p0, __p1, __p2) __extension__ ({ \
34178 float16x4x2_t __ret; \
34179 float16x4x2_t __s1 = __p1; \
34180 float16x4x2_t __rev1; \
34181 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
34182 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
34183 __builtin_neon_vld2_lane_v(&__ret, __p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], __p2, 8); \
34184 \
34185 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
34186 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
34187 __ret; \
34188})
35128__ai __attribute__((target("fullfp16"))) int16x4_t vcvtp_s16_f16(float16x4_t __p0) {
35129 int16x4_t __ret;
35130 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35131 __ret = (int16x4_t) __builtin_neon_vcvtp_s16_f16((int8x8_t)__rev0, 1);
35132 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35133 return __ret;
35134}
3418935135#endif
3419035136
3419135137#ifdef __LITTLE_ENDIAN__
34192#define vld3q_f16(__p0) __extension__ ({ \
34193 float16x8x3_t __ret; \
34194 __builtin_neon_vld3q_v(&__ret, __p0, 40); \
34195 __ret; \
34196})
35138__ai __attribute__((target("fullfp16"))) uint16x8_t vcvtpq_u16_f16(float16x8_t __p0) {
35139 uint16x8_t __ret;
35140 __ret = (uint16x8_t) __builtin_neon_vcvtpq_u16_f16((int8x16_t)__p0, 49);
35141 return __ret;
35142}
3419735143#else
34198#define vld3q_f16(__p0) __extension__ ({ \
34199 float16x8x3_t __ret; \
34200 __builtin_neon_vld3q_v(&__ret, __p0, 40); \
34201 \
34202 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
34203 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
34204 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
34205 __ret; \
34206})
35144__ai __attribute__((target("fullfp16"))) uint16x8_t vcvtpq_u16_f16(float16x8_t __p0) {
35145 uint16x8_t __ret;
35146 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35147 __ret = (uint16x8_t) __builtin_neon_vcvtpq_u16_f16((int8x16_t)__rev0, 49);
35148 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
35149 return __ret;
35150}
3420735151#endif
3420835152
3420935153#ifdef __LITTLE_ENDIAN__
34210#define vld3_f16(__p0) __extension__ ({ \
34211 float16x4x3_t __ret; \
34212 __builtin_neon_vld3_v(&__ret, __p0, 8); \
34213 __ret; \
34214})
35154__ai __attribute__((target("fullfp16"))) uint16x4_t vcvtp_u16_f16(float16x4_t __p0) {
35155 uint16x4_t __ret;
35156 __ret = (uint16x4_t) __builtin_neon_vcvtp_u16_f16((int8x8_t)__p0, 17);
35157 return __ret;
35158}
3421535159#else
34216#define vld3_f16(__p0) __extension__ ({ \
34217 float16x4x3_t __ret; \
34218 __builtin_neon_vld3_v(&__ret, __p0, 8); \
34219 \
34220 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
34221 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
34222 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
34223 __ret; \
34224})
35160__ai __attribute__((target("fullfp16"))) uint16x4_t vcvtp_u16_f16(float16x4_t __p0) {
35161 uint16x4_t __ret;
35162 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35163 __ret = (uint16x4_t) __builtin_neon_vcvtp_u16_f16((int8x8_t)__rev0, 17);
35164 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35165 return __ret;
35166}
3422535167#endif
3422635168
3422735169#ifdef __LITTLE_ENDIAN__
34228#define vld3q_dup_f16(__p0) __extension__ ({ \
34229 float16x8x3_t __ret; \
34230 __builtin_neon_vld3q_dup_v(&__ret, __p0, 40); \
35170#define vextq_f16(__p0, __p1, __p2) __extension__ ({ \
35171 float16x8_t __ret; \
35172 float16x8_t __s0 = __p0; \
35173 float16x8_t __s1 = __p1; \
35174 __ret = (float16x8_t) __builtin_neon_vextq_f16((int8x16_t)__s0, (int8x16_t)__s1, __p2, 40); \
3423135175 __ret; \
3423235176})
3423335177#else
34234#define vld3q_dup_f16(__p0) __extension__ ({ \
34235 float16x8x3_t __ret; \
34236 __builtin_neon_vld3q_dup_v(&__ret, __p0, 40); \
34237 \
34238 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
34239 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
34240 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
35178#define vextq_f16(__p0, __p1, __p2) __extension__ ({ \
35179 float16x8_t __ret; \
35180 float16x8_t __s0 = __p0; \
35181 float16x8_t __s1 = __p1; \
35182 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
35183 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
35184 __ret = (float16x8_t) __builtin_neon_vextq_f16((int8x16_t)__rev0, (int8x16_t)__rev1, __p2, 40); \
35185 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
3424135186 __ret; \
3424235187})
3424335188#endif
3424435189
3424535190#ifdef __LITTLE_ENDIAN__
34246#define vld3_dup_f16(__p0) __extension__ ({ \
34247 float16x4x3_t __ret; \
34248 __builtin_neon_vld3_dup_v(&__ret, __p0, 8); \
35191#define vext_f16(__p0, __p1, __p2) __extension__ ({ \
35192 float16x4_t __ret; \
35193 float16x4_t __s0 = __p0; \
35194 float16x4_t __s1 = __p1; \
35195 __ret = (float16x4_t) __builtin_neon_vext_f16((int8x8_t)__s0, (int8x8_t)__s1, __p2, 8); \
3424935196 __ret; \
3425035197})
3425135198#else
34252#define vld3_dup_f16(__p0) __extension__ ({ \
34253 float16x4x3_t __ret; \
34254 __builtin_neon_vld3_dup_v(&__ret, __p0, 8); \
34255 \
34256 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
34257 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
34258 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
35199#define vext_f16(__p0, __p1, __p2) __extension__ ({ \
35200 float16x4_t __ret; \
35201 float16x4_t __s0 = __p0; \
35202 float16x4_t __s1 = __p1; \
35203 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
35204 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
35205 __ret = (float16x4_t) __builtin_neon_vext_f16((int8x8_t)__rev0, (int8x8_t)__rev1, __p2, 8); \
35206 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
3425935207 __ret; \
3426035208})
3426135209#endif
3426235210
3426335211#ifdef __LITTLE_ENDIAN__
34264#define vld3q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
34265 float16x8x3_t __ret; \
34266 float16x8x3_t __s1 = __p1; \
34267 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 40); \
34268 __ret; \
34269})
35212__ai __attribute__((target("fullfp16"))) float16x8_t vfmaq_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
35213 float16x8_t __ret;
35214 __ret = (float16x8_t) __builtin_neon_vfmaq_f16((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 40);
35215 return __ret;
35216}
3427035217#else
34271#define vld3q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
34272 float16x8x3_t __ret; \
34273 float16x8x3_t __s1 = __p1; \
34274 float16x8x3_t __rev1; \
34275 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
34276 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
34277 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
34278 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 40); \
34279 \
34280 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
34281 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
34282 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
34283 __ret; \
34284})
35218__ai __attribute__((target("fullfp16"))) float16x8_t vfmaq_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
35219 float16x8_t __ret;
35220 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35221 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
35222 float16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
35223 __ret = (float16x8_t) __builtin_neon_vfmaq_f16((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 40);
35224 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
35225 return __ret;
35226}
35227__ai __attribute__((target("fullfp16"))) float16x8_t __noswap_vfmaq_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
35228 float16x8_t __ret;
35229 __ret = (float16x8_t) __builtin_neon_vfmaq_f16((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 40);
35230 return __ret;
35231}
3428535232#endif
3428635233
3428735234#ifdef __LITTLE_ENDIAN__
34288#define vld3_lane_f16(__p0, __p1, __p2) __extension__ ({ \
34289 float16x4x3_t __ret; \
34290 float16x4x3_t __s1 = __p1; \
34291 __builtin_neon_vld3_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], __p2, 8); \
34292 __ret; \
34293})
35235__ai __attribute__((target("fullfp16"))) float16x4_t vfma_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
35236 float16x4_t __ret;
35237 __ret = (float16x4_t) __builtin_neon_vfma_f16((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 8);
35238 return __ret;
35239}
3429435240#else
34295#define vld3_lane_f16(__p0, __p1, __p2) __extension__ ({ \
34296 float16x4x3_t __ret; \
34297 float16x4x3_t __s1 = __p1; \
34298 float16x4x3_t __rev1; \
34299 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
34300 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
34301 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
34302 __builtin_neon_vld3_lane_v(&__ret, __p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], __p2, 8); \
34303 \
34304 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
34305 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
34306 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
34307 __ret; \
34308})
35241__ai __attribute__((target("fullfp16"))) float16x4_t vfma_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
35242 float16x4_t __ret;
35243 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35244 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
35245 float16x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
35246 __ret = (float16x4_t) __builtin_neon_vfma_f16((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 8);
35247 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35248 return __ret;
35249}
35250__ai __attribute__((target("fullfp16"))) float16x4_t __noswap_vfma_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
35251 float16x4_t __ret;
35252 __ret = (float16x4_t) __builtin_neon_vfma_f16((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 8);
35253 return __ret;
35254}
3430935255#endif
3431035256
3431135257#ifdef __LITTLE_ENDIAN__
34312#define vld4q_f16(__p0) __extension__ ({ \
34313 float16x8x4_t __ret; \
34314 __builtin_neon_vld4q_v(&__ret, __p0, 40); \
34315 __ret; \
34316})
35258__ai __attribute__((target("fullfp16"))) float16x8_t vfmsq_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
35259 float16x8_t __ret;
35260 __ret = vfmaq_f16(__p0, -__p1, __p2);
35261 return __ret;
35262}
3431735263#else
34318#define vld4q_f16(__p0) __extension__ ({ \
34319 float16x8x4_t __ret; \
34320 __builtin_neon_vld4q_v(&__ret, __p0, 40); \
34321 \
34322 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
34323 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
34324 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
34325 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
34326 __ret; \
34327})
35264__ai __attribute__((target("fullfp16"))) float16x8_t vfmsq_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
35265 float16x8_t __ret;
35266 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35267 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
35268 float16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
35269 __ret = __noswap_vfmaq_f16(__rev0, -__rev1, __rev2);
35270 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
35271 return __ret;
35272}
3432835273#endif
3432935274
3433035275#ifdef __LITTLE_ENDIAN__
34331#define vld4_f16(__p0) __extension__ ({ \
34332 float16x4x4_t __ret; \
34333 __builtin_neon_vld4_v(&__ret, __p0, 8); \
34334 __ret; \
34335})
35276__ai __attribute__((target("fullfp16"))) float16x4_t vfms_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
35277 float16x4_t __ret;
35278 __ret = vfma_f16(__p0, -__p1, __p2);
35279 return __ret;
35280}
3433635281#else
34337#define vld4_f16(__p0) __extension__ ({ \
34338 float16x4x4_t __ret; \
34339 __builtin_neon_vld4_v(&__ret, __p0, 8); \
34340 \
34341 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
34342 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
34343 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
34344 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 3, 2, 1, 0); \
34345 __ret; \
34346})
35282__ai __attribute__((target("fullfp16"))) float16x4_t vfms_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
35283 float16x4_t __ret;
35284 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35285 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
35286 float16x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
35287 __ret = __noswap_vfma_f16(__rev0, -__rev1, __rev2);
35288 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35289 return __ret;
35290}
3434735291#endif
3434835292
3434935293#ifdef __LITTLE_ENDIAN__
34350#define vld4q_dup_f16(__p0) __extension__ ({ \
34351 float16x8x4_t __ret; \
34352 __builtin_neon_vld4q_dup_v(&__ret, __p0, 40); \
34353 __ret; \
34354})
35294__ai __attribute__((target("fullfp16"))) float16x8_t vmaxq_f16(float16x8_t __p0, float16x8_t __p1) {
35295 float16x8_t __ret;
35296 __ret = (float16x8_t) __builtin_neon_vmaxq_f16((int8x16_t)__p0, (int8x16_t)__p1, 40);
35297 return __ret;
35298}
3435535299#else
34356#define vld4q_dup_f16(__p0) __extension__ ({ \
34357 float16x8x4_t __ret; \
34358 __builtin_neon_vld4q_dup_v(&__ret, __p0, 40); \
34359 \
34360 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
34361 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
34362 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
34363 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
34364 __ret; \
34365})
35300__ai __attribute__((target("fullfp16"))) float16x8_t vmaxq_f16(float16x8_t __p0, float16x8_t __p1) {
35301 float16x8_t __ret;
35302 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35303 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
35304 __ret = (float16x8_t) __builtin_neon_vmaxq_f16((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
35305 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
35306 return __ret;
35307}
3436635308#endif
3436735309
3436835310#ifdef __LITTLE_ENDIAN__
34369#define vld4_dup_f16(__p0) __extension__ ({ \
34370 float16x4x4_t __ret; \
34371 __builtin_neon_vld4_dup_v(&__ret, __p0, 8); \
34372 __ret; \
34373})
35311__ai __attribute__((target("fullfp16"))) float16x4_t vmax_f16(float16x4_t __p0, float16x4_t __p1) {
35312 float16x4_t __ret;
35313 __ret = (float16x4_t) __builtin_neon_vmax_f16((int8x8_t)__p0, (int8x8_t)__p1, 8);
35314 return __ret;
35315}
3437435316#else
34375#define vld4_dup_f16(__p0) __extension__ ({ \
34376 float16x4x4_t __ret; \
34377 __builtin_neon_vld4_dup_v(&__ret, __p0, 8); \
34378 \
34379 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
34380 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
34381 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
34382 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 3, 2, 1, 0); \
34383 __ret; \
34384})
35317__ai __attribute__((target("fullfp16"))) float16x4_t vmax_f16(float16x4_t __p0, float16x4_t __p1) {
35318 float16x4_t __ret;
35319 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35320 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
35321 __ret = (float16x4_t) __builtin_neon_vmax_f16((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
35322 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35323 return __ret;
35324}
3438535325#endif
3438635326
3438735327#ifdef __LITTLE_ENDIAN__
34388#define vld4q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
34389 float16x8x4_t __ret; \
34390 float16x8x4_t __s1 = __p1; \
34391 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 40); \
34392 __ret; \
34393})
35328__ai __attribute__((target("fullfp16"))) float16x8_t vminq_f16(float16x8_t __p0, float16x8_t __p1) {
35329 float16x8_t __ret;
35330 __ret = (float16x8_t) __builtin_neon_vminq_f16((int8x16_t)__p0, (int8x16_t)__p1, 40);
35331 return __ret;
35332}
3439435333#else
34395#define vld4q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
34396 float16x8x4_t __ret; \
34397 float16x8x4_t __s1 = __p1; \
34398 float16x8x4_t __rev1; \
34399 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
34400 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
34401 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
34402 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
34403 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 40); \
34404 \
34405 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
34406 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
34407 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
34408 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
34409 __ret; \
34410})
35334__ai __attribute__((target("fullfp16"))) float16x8_t vminq_f16(float16x8_t __p0, float16x8_t __p1) {
35335 float16x8_t __ret;
35336 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35337 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
35338 __ret = (float16x8_t) __builtin_neon_vminq_f16((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
35339 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
35340 return __ret;
35341}
3441135342#endif
3441235343
3441335344#ifdef __LITTLE_ENDIAN__
34414#define vld4_lane_f16(__p0, __p1, __p2) __extension__ ({ \
34415 float16x4x4_t __ret; \
34416 float16x4x4_t __s1 = __p1; \
34417 __builtin_neon_vld4_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], __p2, 8); \
34418 __ret; \
34419})
35345__ai __attribute__((target("fullfp16"))) float16x4_t vmin_f16(float16x4_t __p0, float16x4_t __p1) {
35346 float16x4_t __ret;
35347 __ret = (float16x4_t) __builtin_neon_vmin_f16((int8x8_t)__p0, (int8x8_t)__p1, 8);
35348 return __ret;
35349}
3442035350#else
34421#define vld4_lane_f16(__p0, __p1, __p2) __extension__ ({ \
34422 float16x4x4_t __ret; \
34423 float16x4x4_t __s1 = __p1; \
34424 float16x4x4_t __rev1; \
34425 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
34426 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
34427 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
34428 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 3, 2, 1, 0); \
34429 __builtin_neon_vld4_lane_v(&__ret, __p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], (int8x8_t)__rev1.val[3], __p2, 8); \
34430 \
34431 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
34432 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
34433 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
34434 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 3, 2, 1, 0); \
34435 __ret; \
34436})
35351__ai __attribute__((target("fullfp16"))) float16x4_t vmin_f16(float16x4_t __p0, float16x4_t __p1) {
35352 float16x4_t __ret;
35353 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35354 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
35355 __ret = (float16x4_t) __builtin_neon_vmin_f16((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
35356 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35357 return __ret;
35358}
3443735359#endif
3443835360
3443935361#ifdef __LITTLE_ENDIAN__
34440#define vst1q_f16(__p0, __p1) __extension__ ({ \
34441 float16x8_t __s1 = __p1; \
34442 __builtin_neon_vst1q_v(__p0, (int8x16_t)__s1, 40); \
34443})
35362__ai __attribute__((target("fullfp16"))) float16x8_t vmulq_f16(float16x8_t __p0, float16x8_t __p1) {
35363 float16x8_t __ret;
35364 __ret = __p0 * __p1;
35365 return __ret;
35366}
3444435367#else
34445#define vst1q_f16(__p0, __p1) __extension__ ({ \
34446 float16x8_t __s1 = __p1; \
34447 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
34448 __builtin_neon_vst1q_v(__p0, (int8x16_t)__rev1, 40); \
34449})
35368__ai __attribute__((target("fullfp16"))) float16x8_t vmulq_f16(float16x8_t __p0, float16x8_t __p1) {
35369 float16x8_t __ret;
35370 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35371 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
35372 __ret = __rev0 * __rev1;
35373 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
35374 return __ret;
35375}
3445035376#endif
3445135377
3445235378#ifdef __LITTLE_ENDIAN__
34453#define vst1_f16(__p0, __p1) __extension__ ({ \
34454 float16x4_t __s1 = __p1; \
34455 __builtin_neon_vst1_v(__p0, (int8x8_t)__s1, 8); \
34456})
35379__ai __attribute__((target("fullfp16"))) float16x4_t vmul_f16(float16x4_t __p0, float16x4_t __p1) {
35380 float16x4_t __ret;
35381 __ret = __p0 * __p1;
35382 return __ret;
35383}
3445735384#else
34458#define vst1_f16(__p0, __p1) __extension__ ({ \
34459 float16x4_t __s1 = __p1; \
34460 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
34461 __builtin_neon_vst1_v(__p0, (int8x8_t)__rev1, 8); \
34462})
35385__ai __attribute__((target("fullfp16"))) float16x4_t vmul_f16(float16x4_t __p0, float16x4_t __p1) {
35386 float16x4_t __ret;
35387 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35388 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
35389 __ret = __rev0 * __rev1;
35390 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35391 return __ret;
35392}
3446335393#endif
3446435394
3446535395#ifdef __LITTLE_ENDIAN__
34466#define vst1q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
34467 float16x8_t __s1 = __p1; \
34468 __builtin_neon_vst1q_lane_v(__p0, (int8x16_t)__s1, __p2, 40); \
35396#define vmulq_lane_f16(__p0_153, __p1_153, __p2_153) __extension__ ({ \
35397 float16x8_t __ret_153; \
35398 float16x8_t __s0_153 = __p0_153; \
35399 float16x4_t __s1_153 = __p1_153; \
35400 __ret_153 = __s0_153 * splatq_lane_f16(__s1_153, __p2_153); \
35401 __ret_153; \
3446935402})
3447035403#else
34471#define vst1q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
34472 float16x8_t __s1 = __p1; \
34473 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
34474 __builtin_neon_vst1q_lane_v(__p0, (int8x16_t)__rev1, __p2, 40); \
35404#define vmulq_lane_f16(__p0_154, __p1_154, __p2_154) __extension__ ({ \
35405 float16x8_t __ret_154; \
35406 float16x8_t __s0_154 = __p0_154; \
35407 float16x4_t __s1_154 = __p1_154; \
35408 float16x8_t __rev0_154; __rev0_154 = __builtin_shufflevector(__s0_154, __s0_154, 7, 6, 5, 4, 3, 2, 1, 0); \
35409 float16x4_t __rev1_154; __rev1_154 = __builtin_shufflevector(__s1_154, __s1_154, 3, 2, 1, 0); \
35410 __ret_154 = __rev0_154 * __noswap_splatq_lane_f16(__rev1_154, __p2_154); \
35411 __ret_154 = __builtin_shufflevector(__ret_154, __ret_154, 7, 6, 5, 4, 3, 2, 1, 0); \
35412 __ret_154; \
3447535413})
3447635414#endif
3447735415
3447835416#ifdef __LITTLE_ENDIAN__
34479#define vst1_lane_f16(__p0, __p1, __p2) __extension__ ({ \
34480 float16x4_t __s1 = __p1; \
34481 __builtin_neon_vst1_lane_v(__p0, (int8x8_t)__s1, __p2, 8); \
35417#define vmul_lane_f16(__p0_155, __p1_155, __p2_155) __extension__ ({ \
35418 float16x4_t __ret_155; \
35419 float16x4_t __s0_155 = __p0_155; \
35420 float16x4_t __s1_155 = __p1_155; \
35421 __ret_155 = __s0_155 * splat_lane_f16(__s1_155, __p2_155); \
35422 __ret_155; \
3448235423})
3448335424#else
34484#define vst1_lane_f16(__p0, __p1, __p2) __extension__ ({ \
34485 float16x4_t __s1 = __p1; \
34486 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
34487 __builtin_neon_vst1_lane_v(__p0, (int8x8_t)__rev1, __p2, 8); \
35425#define vmul_lane_f16(__p0_156, __p1_156, __p2_156) __extension__ ({ \
35426 float16x4_t __ret_156; \
35427 float16x4_t __s0_156 = __p0_156; \
35428 float16x4_t __s1_156 = __p1_156; \
35429 float16x4_t __rev0_156; __rev0_156 = __builtin_shufflevector(__s0_156, __s0_156, 3, 2, 1, 0); \
35430 float16x4_t __rev1_156; __rev1_156 = __builtin_shufflevector(__s1_156, __s1_156, 3, 2, 1, 0); \
35431 __ret_156 = __rev0_156 * __noswap_splat_lane_f16(__rev1_156, __p2_156); \
35432 __ret_156 = __builtin_shufflevector(__ret_156, __ret_156, 3, 2, 1, 0); \
35433 __ret_156; \
3448835434})
3448935435#endif
3449035436
3449135437#ifdef __LITTLE_ENDIAN__
34492#define vst1q_f16_x2(__p0, __p1) __extension__ ({ \
34493 float16x8x2_t __s1 = __p1; \
34494 __builtin_neon_vst1q_x2_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], 40); \
35438#define vmulq_n_f16(__p0, __p1) __extension__ ({ \
35439 float16x8_t __ret; \
35440 float16x8_t __s0 = __p0; \
35441 float16_t __s1 = __p1; \
35442 __ret = __s0 * (float16x8_t) {__s1, __s1, __s1, __s1, __s1, __s1, __s1, __s1}; \
35443 __ret; \
3449535444})
3449635445#else
34497#define vst1q_f16_x2(__p0, __p1) __extension__ ({ \
34498 float16x8x2_t __s1 = __p1; \
34499 float16x8x2_t __rev1; \
34500 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
34501 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
34502 __builtin_neon_vst1q_x2_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], 40); \
35446#define vmulq_n_f16(__p0, __p1) __extension__ ({ \
35447 float16x8_t __ret; \
35448 float16x8_t __s0 = __p0; \
35449 float16_t __s1 = __p1; \
35450 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
35451 __ret = __rev0 * (float16x8_t) {__s1, __s1, __s1, __s1, __s1, __s1, __s1, __s1}; \
35452 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
35453 __ret; \
3450335454})
3450435455#endif
3450535456
3450635457#ifdef __LITTLE_ENDIAN__
34507#define vst1_f16_x2(__p0, __p1) __extension__ ({ \
34508 float16x4x2_t __s1 = __p1; \
34509 __builtin_neon_vst1_x2_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], 8); \
35458#define vmul_n_f16(__p0, __p1) __extension__ ({ \
35459 float16x4_t __ret; \
35460 float16x4_t __s0 = __p0; \
35461 float16_t __s1 = __p1; \
35462 __ret = __s0 * (float16x4_t) {__s1, __s1, __s1, __s1}; \
35463 __ret; \
3451035464})
3451135465#else
34512#define vst1_f16_x2(__p0, __p1) __extension__ ({ \
34513 float16x4x2_t __s1 = __p1; \
34514 float16x4x2_t __rev1; \
34515 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
34516 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
34517 __builtin_neon_vst1_x2_v(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], 8); \
35466#define vmul_n_f16(__p0, __p1) __extension__ ({ \
35467 float16x4_t __ret; \
35468 float16x4_t __s0 = __p0; \
35469 float16_t __s1 = __p1; \
35470 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
35471 __ret = __rev0 * (float16x4_t) {__s1, __s1, __s1, __s1}; \
35472 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
35473 __ret; \
3451835474})
3451935475#endif
3452035476
3452135477#ifdef __LITTLE_ENDIAN__
34522#define vst1q_f16_x3(__p0, __p1) __extension__ ({ \
34523 float16x8x3_t __s1 = __p1; \
34524 __builtin_neon_vst1q_x3_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], 40); \
34525})
35478__ai __attribute__((target("fullfp16"))) float16x8_t vnegq_f16(float16x8_t __p0) {
35479 float16x8_t __ret;
35480 __ret = -__p0;
35481 return __ret;
35482}
3452635483#else
34527#define vst1q_f16_x3(__p0, __p1) __extension__ ({ \
34528 float16x8x3_t __s1 = __p1; \
34529 float16x8x3_t __rev1; \
34530 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
34531 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
34532 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
34533 __builtin_neon_vst1q_x3_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], 40); \
34534})
35484__ai __attribute__((target("fullfp16"))) float16x8_t vnegq_f16(float16x8_t __p0) {
35485 float16x8_t __ret;
35486 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35487 __ret = -__rev0;
35488 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
35489 return __ret;
35490}
3453535491#endif
3453635492
3453735493#ifdef __LITTLE_ENDIAN__
34538#define vst1_f16_x3(__p0, __p1) __extension__ ({ \
34539 float16x4x3_t __s1 = __p1; \
34540 __builtin_neon_vst1_x3_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], 8); \
34541})
35494__ai __attribute__((target("fullfp16"))) float16x4_t vneg_f16(float16x4_t __p0) {
35495 float16x4_t __ret;
35496 __ret = -__p0;
35497 return __ret;
35498}
3454235499#else
34543#define vst1_f16_x3(__p0, __p1) __extension__ ({ \
34544 float16x4x3_t __s1 = __p1; \
34545 float16x4x3_t __rev1; \
34546 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
34547 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
34548 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
34549 __builtin_neon_vst1_x3_v(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], 8); \
34550})
35500__ai __attribute__((target("fullfp16"))) float16x4_t vneg_f16(float16x4_t __p0) {
35501 float16x4_t __ret;
35502 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35503 __ret = -__rev0;
35504 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35505 return __ret;
35506}
3455135507#endif
3455235508
3455335509#ifdef __LITTLE_ENDIAN__
34554#define vst1q_f16_x4(__p0, __p1) __extension__ ({ \
34555 float16x8x4_t __s1 = __p1; \
34556 __builtin_neon_vst1q_x4_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], 40); \
34557})
35510__ai __attribute__((target("fullfp16"))) float16x4_t vpadd_f16(float16x4_t __p0, float16x4_t __p1) {
35511 float16x4_t __ret;
35512 __ret = (float16x4_t) __builtin_neon_vpadd_f16((int8x8_t)__p0, (int8x8_t)__p1, 8);
35513 return __ret;
35514}
3455835515#else
34559#define vst1q_f16_x4(__p0, __p1) __extension__ ({ \
34560 float16x8x4_t __s1 = __p1; \
34561 float16x8x4_t __rev1; \
34562 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
34563 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
34564 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
34565 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
34566 __builtin_neon_vst1q_x4_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], 40); \
34567})
35516__ai __attribute__((target("fullfp16"))) float16x4_t vpadd_f16(float16x4_t __p0, float16x4_t __p1) {
35517 float16x4_t __ret;
35518 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35519 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
35520 __ret = (float16x4_t) __builtin_neon_vpadd_f16((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
35521 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35522 return __ret;
35523}
3456835524#endif
3456935525
3457035526#ifdef __LITTLE_ENDIAN__
34571#define vst1_f16_x4(__p0, __p1) __extension__ ({ \
34572 float16x4x4_t __s1 = __p1; \
34573 __builtin_neon_vst1_x4_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], 8); \
34574})
35527__ai __attribute__((target("fullfp16"))) float16x4_t vpmax_f16(float16x4_t __p0, float16x4_t __p1) {
35528 float16x4_t __ret;
35529 __ret = (float16x4_t) __builtin_neon_vpmax_f16((int8x8_t)__p0, (int8x8_t)__p1, 8);
35530 return __ret;
35531}
3457535532#else
34576#define vst1_f16_x4(__p0, __p1) __extension__ ({ \
34577 float16x4x4_t __s1 = __p1; \
34578 float16x4x4_t __rev1; \
34579 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
34580 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
34581 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
34582 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 3, 2, 1, 0); \
34583 __builtin_neon_vst1_x4_v(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], (int8x8_t)__rev1.val[3], 8); \
34584})
35533__ai __attribute__((target("fullfp16"))) float16x4_t vpmax_f16(float16x4_t __p0, float16x4_t __p1) {
35534 float16x4_t __ret;
35535 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35536 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
35537 __ret = (float16x4_t) __builtin_neon_vpmax_f16((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
35538 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35539 return __ret;
35540}
3458535541#endif
3458635542
3458735543#ifdef __LITTLE_ENDIAN__
34588#define vst2q_f16(__p0, __p1) __extension__ ({ \
34589 float16x8x2_t __s1 = __p1; \
34590 __builtin_neon_vst2q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], 40); \
34591})
35544__ai __attribute__((target("fullfp16"))) float16x4_t vpmin_f16(float16x4_t __p0, float16x4_t __p1) {
35545 float16x4_t __ret;
35546 __ret = (float16x4_t) __builtin_neon_vpmin_f16((int8x8_t)__p0, (int8x8_t)__p1, 8);
35547 return __ret;
35548}
3459235549#else
34593#define vst2q_f16(__p0, __p1) __extension__ ({ \
34594 float16x8x2_t __s1 = __p1; \
34595 float16x8x2_t __rev1; \
34596 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
34597 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
34598 __builtin_neon_vst2q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], 40); \
34599})
35550__ai __attribute__((target("fullfp16"))) float16x4_t vpmin_f16(float16x4_t __p0, float16x4_t __p1) {
35551 float16x4_t __ret;
35552 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35553 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
35554 __ret = (float16x4_t) __builtin_neon_vpmin_f16((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
35555 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35556 return __ret;
35557}
3460035558#endif
3460135559
3460235560#ifdef __LITTLE_ENDIAN__
34603#define vst2_f16(__p0, __p1) __extension__ ({ \
34604 float16x4x2_t __s1 = __p1; \
34605 __builtin_neon_vst2_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], 8); \
34606})
35561__ai __attribute__((target("fullfp16"))) float16x8_t vrecpeq_f16(float16x8_t __p0) {
35562 float16x8_t __ret;
35563 __ret = (float16x8_t) __builtin_neon_vrecpeq_f16((int8x16_t)__p0, 40);
35564 return __ret;
35565}
3460735566#else
34608#define vst2_f16(__p0, __p1) __extension__ ({ \
34609 float16x4x2_t __s1 = __p1; \
34610 float16x4x2_t __rev1; \
34611 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
34612 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
34613 __builtin_neon_vst2_v(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], 8); \
34614})
35567__ai __attribute__((target("fullfp16"))) float16x8_t vrecpeq_f16(float16x8_t __p0) {
35568 float16x8_t __ret;
35569 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35570 __ret = (float16x8_t) __builtin_neon_vrecpeq_f16((int8x16_t)__rev0, 40);
35571 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
35572 return __ret;
35573}
3461535574#endif
3461635575
3461735576#ifdef __LITTLE_ENDIAN__
34618#define vst2q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
34619 float16x8x2_t __s1 = __p1; \
34620 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 40); \
34621})
35577__ai __attribute__((target("fullfp16"))) float16x4_t vrecpe_f16(float16x4_t __p0) {
35578 float16x4_t __ret;
35579 __ret = (float16x4_t) __builtin_neon_vrecpe_f16((int8x8_t)__p0, 8);
35580 return __ret;
35581}
3462235582#else
34623#define vst2q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
34624 float16x8x2_t __s1 = __p1; \
34625 float16x8x2_t __rev1; \
34626 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
34627 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
34628 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 40); \
34629})
35583__ai __attribute__((target("fullfp16"))) float16x4_t vrecpe_f16(float16x4_t __p0) {
35584 float16x4_t __ret;
35585 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35586 __ret = (float16x4_t) __builtin_neon_vrecpe_f16((int8x8_t)__rev0, 8);
35587 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35588 return __ret;
35589}
3463035590#endif
3463135591
3463235592#ifdef __LITTLE_ENDIAN__
34633#define vst2_lane_f16(__p0, __p1, __p2) __extension__ ({ \
34634 float16x4x2_t __s1 = __p1; \
34635 __builtin_neon_vst2_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], __p2, 8); \
34636})
35593__ai __attribute__((target("fullfp16"))) float16x8_t vrecpsq_f16(float16x8_t __p0, float16x8_t __p1) {
35594 float16x8_t __ret;
35595 __ret = (float16x8_t) __builtin_neon_vrecpsq_f16((int8x16_t)__p0, (int8x16_t)__p1, 40);
35596 return __ret;
35597}
3463735598#else
34638#define vst2_lane_f16(__p0, __p1, __p2) __extension__ ({ \
34639 float16x4x2_t __s1 = __p1; \
34640 float16x4x2_t __rev1; \
34641 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
34642 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
34643 __builtin_neon_vst2_lane_v(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], __p2, 8); \
34644})
35599__ai __attribute__((target("fullfp16"))) float16x8_t vrecpsq_f16(float16x8_t __p0, float16x8_t __p1) {
35600 float16x8_t __ret;
35601 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35602 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
35603 __ret = (float16x8_t) __builtin_neon_vrecpsq_f16((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
35604 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
35605 return __ret;
35606}
3464535607#endif
3464635608
3464735609#ifdef __LITTLE_ENDIAN__
34648#define vst3q_f16(__p0, __p1) __extension__ ({ \
34649 float16x8x3_t __s1 = __p1; \
34650 __builtin_neon_vst3q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], 40); \
34651})
35610__ai __attribute__((target("fullfp16"))) float16x4_t vrecps_f16(float16x4_t __p0, float16x4_t __p1) {
35611 float16x4_t __ret;
35612 __ret = (float16x4_t) __builtin_neon_vrecps_f16((int8x8_t)__p0, (int8x8_t)__p1, 8);
35613 return __ret;
35614}
3465235615#else
34653#define vst3q_f16(__p0, __p1) __extension__ ({ \
34654 float16x8x3_t __s1 = __p1; \
34655 float16x8x3_t __rev1; \
34656 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
34657 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
34658 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
34659 __builtin_neon_vst3q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], 40); \
34660})
35616__ai __attribute__((target("fullfp16"))) float16x4_t vrecps_f16(float16x4_t __p0, float16x4_t __p1) {
35617 float16x4_t __ret;
35618 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35619 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
35620 __ret = (float16x4_t) __builtin_neon_vrecps_f16((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
35621 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35622 return __ret;
35623}
3466135624#endif
3466235625
3466335626#ifdef __LITTLE_ENDIAN__
34664#define vst3_f16(__p0, __p1) __extension__ ({ \
34665 float16x4x3_t __s1 = __p1; \
34666 __builtin_neon_vst3_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], 8); \
34667})
35627__ai __attribute__((target("fullfp16"))) float16x8_t vrev64q_f16(float16x8_t __p0) {
35628 float16x8_t __ret;
35629 __ret = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0, 7, 6, 5, 4);
35630 return __ret;
35631}
3466835632#else
34669#define vst3_f16(__p0, __p1) __extension__ ({ \
34670 float16x4x3_t __s1 = __p1; \
34671 float16x4x3_t __rev1; \
34672 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
34673 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
34674 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
34675 __builtin_neon_vst3_v(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], 8); \
34676})
35633__ai __attribute__((target("fullfp16"))) float16x8_t vrev64q_f16(float16x8_t __p0) {
35634 float16x8_t __ret;
35635 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35636 __ret = __builtin_shufflevector(__rev0, __rev0, 3, 2, 1, 0, 7, 6, 5, 4);
35637 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
35638 return __ret;
35639}
3467735640#endif
3467835641
3467935642#ifdef __LITTLE_ENDIAN__
34680#define vst3q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
34681 float16x8x3_t __s1 = __p1; \
34682 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 40); \
34683})
35643__ai __attribute__((target("fullfp16"))) float16x4_t vrev64_f16(float16x4_t __p0) {
35644 float16x4_t __ret;
35645 __ret = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35646 return __ret;
35647}
3468435648#else
34685#define vst3q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
34686 float16x8x3_t __s1 = __p1; \
34687 float16x8x3_t __rev1; \
34688 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
34689 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
34690 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
34691 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 40); \
34692})
35649__ai __attribute__((target("fullfp16"))) float16x4_t vrev64_f16(float16x4_t __p0) {
35650 float16x4_t __ret;
35651 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35652 __ret = __builtin_shufflevector(__rev0, __rev0, 3, 2, 1, 0);
35653 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35654 return __ret;
35655}
3469335656#endif
3469435657
3469535658#ifdef __LITTLE_ENDIAN__
34696#define vst3_lane_f16(__p0, __p1, __p2) __extension__ ({ \
34697 float16x4x3_t __s1 = __p1; \
34698 __builtin_neon_vst3_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], __p2, 8); \
34699})
35659__ai __attribute__((target("fullfp16"))) float16x8_t vrsqrteq_f16(float16x8_t __p0) {
35660 float16x8_t __ret;
35661 __ret = (float16x8_t) __builtin_neon_vrsqrteq_f16((int8x16_t)__p0, 40);
35662 return __ret;
35663}
3470035664#else
34701#define vst3_lane_f16(__p0, __p1, __p2) __extension__ ({ \
34702 float16x4x3_t __s1 = __p1; \
34703 float16x4x3_t __rev1; \
34704 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
34705 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
34706 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
34707 __builtin_neon_vst3_lane_v(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], __p2, 8); \
34708})
35665__ai __attribute__((target("fullfp16"))) float16x8_t vrsqrteq_f16(float16x8_t __p0) {
35666 float16x8_t __ret;
35667 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35668 __ret = (float16x8_t) __builtin_neon_vrsqrteq_f16((int8x16_t)__rev0, 40);
35669 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
35670 return __ret;
35671}
3470935672#endif
3471035673
3471135674#ifdef __LITTLE_ENDIAN__
34712#define vst4q_f16(__p0, __p1) __extension__ ({ \
34713 float16x8x4_t __s1 = __p1; \
34714 __builtin_neon_vst4q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], 40); \
34715})
35675__ai __attribute__((target("fullfp16"))) float16x4_t vrsqrte_f16(float16x4_t __p0) {
35676 float16x4_t __ret;
35677 __ret = (float16x4_t) __builtin_neon_vrsqrte_f16((int8x8_t)__p0, 8);
35678 return __ret;
35679}
3471635680#else
34717#define vst4q_f16(__p0, __p1) __extension__ ({ \
34718 float16x8x4_t __s1 = __p1; \
34719 float16x8x4_t __rev1; \
34720 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
34721 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
34722 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
34723 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
34724 __builtin_neon_vst4q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], 40); \
34725})
35681__ai __attribute__((target("fullfp16"))) float16x4_t vrsqrte_f16(float16x4_t __p0) {
35682 float16x4_t __ret;
35683 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35684 __ret = (float16x4_t) __builtin_neon_vrsqrte_f16((int8x8_t)__rev0, 8);
35685 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35686 return __ret;
35687}
3472635688#endif
3472735689
3472835690#ifdef __LITTLE_ENDIAN__
34729#define vst4_f16(__p0, __p1) __extension__ ({ \
34730 float16x4x4_t __s1 = __p1; \
34731 __builtin_neon_vst4_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], 8); \
34732})
35691__ai __attribute__((target("fullfp16"))) float16x8_t vrsqrtsq_f16(float16x8_t __p0, float16x8_t __p1) {
35692 float16x8_t __ret;
35693 __ret = (float16x8_t) __builtin_neon_vrsqrtsq_f16((int8x16_t)__p0, (int8x16_t)__p1, 40);
35694 return __ret;
35695}
3473335696#else
34734#define vst4_f16(__p0, __p1) __extension__ ({ \
34735 float16x4x4_t __s1 = __p1; \
34736 float16x4x4_t __rev1; \
34737 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
34738 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
34739 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
34740 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 3, 2, 1, 0); \
34741 __builtin_neon_vst4_v(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], (int8x8_t)__rev1.val[3], 8); \
34742})
35697__ai __attribute__((target("fullfp16"))) float16x8_t vrsqrtsq_f16(float16x8_t __p0, float16x8_t __p1) {
35698 float16x8_t __ret;
35699 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35700 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
35701 __ret = (float16x8_t) __builtin_neon_vrsqrtsq_f16((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
35702 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
35703 return __ret;
35704}
3474335705#endif
3474435706
3474535707#ifdef __LITTLE_ENDIAN__
34746#define vst4q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
34747 float16x8x4_t __s1 = __p1; \
34748 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 40); \
34749})
35708__ai __attribute__((target("fullfp16"))) float16x4_t vrsqrts_f16(float16x4_t __p0, float16x4_t __p1) {
35709 float16x4_t __ret;
35710 __ret = (float16x4_t) __builtin_neon_vrsqrts_f16((int8x8_t)__p0, (int8x8_t)__p1, 8);
35711 return __ret;
35712}
3475035713#else
34751#define vst4q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
34752 float16x8x4_t __s1 = __p1; \
34753 float16x8x4_t __rev1; \
34754 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
34755 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
34756 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
34757 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
34758 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 40); \
34759})
35714__ai __attribute__((target("fullfp16"))) float16x4_t vrsqrts_f16(float16x4_t __p0, float16x4_t __p1) {
35715 float16x4_t __ret;
35716 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35717 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
35718 __ret = (float16x4_t) __builtin_neon_vrsqrts_f16((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
35719 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35720 return __ret;
35721}
3476035722#endif
3476135723
3476235724#ifdef __LITTLE_ENDIAN__
34763#define vst4_lane_f16(__p0, __p1, __p2) __extension__ ({ \
34764 float16x4x4_t __s1 = __p1; \
34765 __builtin_neon_vst4_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], __p2, 8); \
34766})
35725__ai __attribute__((target("fullfp16"))) float16x8_t vsubq_f16(float16x8_t __p0, float16x8_t __p1) {
35726 float16x8_t __ret;
35727 __ret = __p0 - __p1;
35728 return __ret;
35729}
3476735730#else
34768#define vst4_lane_f16(__p0, __p1, __p2) __extension__ ({ \
34769 float16x4x4_t __s1 = __p1; \
34770 float16x4x4_t __rev1; \
34771 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
34772 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
34773 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
34774 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 3, 2, 1, 0); \
34775 __builtin_neon_vst4_lane_v(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], (int8x8_t)__rev1.val[3], __p2, 8); \
34776})
35731__ai __attribute__((target("fullfp16"))) float16x8_t vsubq_f16(float16x8_t __p0, float16x8_t __p1) {
35732 float16x8_t __ret;
35733 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35734 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
35735 __ret = __rev0 - __rev1;
35736 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
35737 return __ret;
35738}
3477735739#endif
3477835740
34779#endif
34780#if __ARM_ARCH >= 8
3478135741#ifdef __LITTLE_ENDIAN__
34782__ai int32x4_t vcvtaq_s32_f32(float32x4_t __p0) {
34783 int32x4_t __ret;
34784 __ret = (int32x4_t) __builtin_neon_vcvtaq_s32_v((int8x16_t)__p0, 34);
35742__ai __attribute__((target("fullfp16"))) float16x4_t vsub_f16(float16x4_t __p0, float16x4_t __p1) {
35743 float16x4_t __ret;
35744 __ret = __p0 - __p1;
3478535745 return __ret;
3478635746}
3478735747#else
34788__ai int32x4_t vcvtaq_s32_f32(float32x4_t __p0) {
34789 int32x4_t __ret;
34790 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34791 __ret = (int32x4_t) __builtin_neon_vcvtaq_s32_v((int8x16_t)__rev0, 34);
35748__ai __attribute__((target("fullfp16"))) float16x4_t vsub_f16(float16x4_t __p0, float16x4_t __p1) {
35749 float16x4_t __ret;
35750 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35751 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
35752 __ret = __rev0 - __rev1;
3479235753 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3479335754 return __ret;
3479435755}
3479535756#endif
3479635757
3479735758#ifdef __LITTLE_ENDIAN__
34798__ai int32x2_t vcvta_s32_f32(float32x2_t __p0) {
34799 int32x2_t __ret;
34800 __ret = (int32x2_t) __builtin_neon_vcvta_s32_v((int8x8_t)__p0, 2);
35759__ai __attribute__((target("fullfp16"))) float16x8x2_t vtrnq_f16(float16x8_t __p0, float16x8_t __p1) {
35760 float16x8x2_t __ret;
35761 __builtin_neon_vtrnq_f16(&__ret, (int8x16_t)__p0, (int8x16_t)__p1, 40);
3480135762 return __ret;
3480235763}
3480335764#else
34804__ai int32x2_t vcvta_s32_f32(float32x2_t __p0) {
34805 int32x2_t __ret;
34806 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
34807 __ret = (int32x2_t) __builtin_neon_vcvta_s32_v((int8x8_t)__rev0, 2);
34808 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
35765__ai __attribute__((target("fullfp16"))) float16x8x2_t vtrnq_f16(float16x8_t __p0, float16x8_t __p1) {
35766 float16x8x2_t __ret;
35767 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35768 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
35769 __builtin_neon_vtrnq_f16(&__ret, (int8x16_t)__rev0, (int8x16_t)__rev1, 40);
35770
35771 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0);
35772 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0);
3480935773 return __ret;
3481035774}
3481135775#endif
3481235776
3481335777#ifdef __LITTLE_ENDIAN__
34814__ai uint32x4_t vcvtaq_u32_f32(float32x4_t __p0) {
34815 uint32x4_t __ret;
34816 __ret = (uint32x4_t) __builtin_neon_vcvtaq_u32_v((int8x16_t)__p0, 50);
35778__ai __attribute__((target("fullfp16"))) float16x4x2_t vtrn_f16(float16x4_t __p0, float16x4_t __p1) {
35779 float16x4x2_t __ret;
35780 __builtin_neon_vtrn_f16(&__ret, (int8x8_t)__p0, (int8x8_t)__p1, 8);
3481735781 return __ret;
3481835782}
3481935783#else
34820__ai uint32x4_t vcvtaq_u32_f32(float32x4_t __p0) {
34821 uint32x4_t __ret;
34822 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34823 __ret = (uint32x4_t) __builtin_neon_vcvtaq_u32_v((int8x16_t)__rev0, 50);
34824 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35784__ai __attribute__((target("fullfp16"))) float16x4x2_t vtrn_f16(float16x4_t __p0, float16x4_t __p1) {
35785 float16x4x2_t __ret;
35786 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35787 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
35788 __builtin_neon_vtrn_f16(&__ret, (int8x8_t)__rev0, (int8x8_t)__rev1, 8);
35789
35790 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0);
35791 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0);
3482535792 return __ret;
3482635793}
3482735794#endif
3482835795
3482935796#ifdef __LITTLE_ENDIAN__
34830__ai uint32x2_t vcvta_u32_f32(float32x2_t __p0) {
34831 uint32x2_t __ret;
34832 __ret = (uint32x2_t) __builtin_neon_vcvta_u32_v((int8x8_t)__p0, 18);
35797__ai __attribute__((target("fullfp16"))) float16x8x2_t vuzpq_f16(float16x8_t __p0, float16x8_t __p1) {
35798 float16x8x2_t __ret;
35799 __builtin_neon_vuzpq_f16(&__ret, (int8x16_t)__p0, (int8x16_t)__p1, 40);
3483335800 return __ret;
3483435801}
3483535802#else
34836__ai uint32x2_t vcvta_u32_f32(float32x2_t __p0) {
34837 uint32x2_t __ret;
34838 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
34839 __ret = (uint32x2_t) __builtin_neon_vcvta_u32_v((int8x8_t)__rev0, 18);
34840 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
35803__ai __attribute__((target("fullfp16"))) float16x8x2_t vuzpq_f16(float16x8_t __p0, float16x8_t __p1) {
35804 float16x8x2_t __ret;
35805 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35806 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
35807 __builtin_neon_vuzpq_f16(&__ret, (int8x16_t)__rev0, (int8x16_t)__rev1, 40);
35808
35809 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0);
35810 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0);
3484135811 return __ret;
3484235812}
3484335813#endif
3484435814
3484535815#ifdef __LITTLE_ENDIAN__
34846__ai int32x4_t vcvtmq_s32_f32(float32x4_t __p0) {
34847 int32x4_t __ret;
34848 __ret = (int32x4_t) __builtin_neon_vcvtmq_s32_v((int8x16_t)__p0, 34);
35816__ai __attribute__((target("fullfp16"))) float16x4x2_t vuzp_f16(float16x4_t __p0, float16x4_t __p1) {
35817 float16x4x2_t __ret;
35818 __builtin_neon_vuzp_f16(&__ret, (int8x8_t)__p0, (int8x8_t)__p1, 8);
3484935819 return __ret;
3485035820}
3485135821#else
34852__ai int32x4_t vcvtmq_s32_f32(float32x4_t __p0) {
34853 int32x4_t __ret;
34854 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34855 __ret = (int32x4_t) __builtin_neon_vcvtmq_s32_v((int8x16_t)__rev0, 34);
34856 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35822__ai __attribute__((target("fullfp16"))) float16x4x2_t vuzp_f16(float16x4_t __p0, float16x4_t __p1) {
35823 float16x4x2_t __ret;
35824 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35825 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
35826 __builtin_neon_vuzp_f16(&__ret, (int8x8_t)__rev0, (int8x8_t)__rev1, 8);
35827
35828 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0);
35829 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0);
3485735830 return __ret;
3485835831}
3485935832#endif
3486035833
3486135834#ifdef __LITTLE_ENDIAN__
34862__ai int32x2_t vcvtm_s32_f32(float32x2_t __p0) {
34863 int32x2_t __ret;
34864 __ret = (int32x2_t) __builtin_neon_vcvtm_s32_v((int8x8_t)__p0, 2);
35835__ai __attribute__((target("fullfp16"))) float16x8x2_t vzipq_f16(float16x8_t __p0, float16x8_t __p1) {
35836 float16x8x2_t __ret;
35837 __builtin_neon_vzipq_f16(&__ret, (int8x16_t)__p0, (int8x16_t)__p1, 40);
3486535838 return __ret;
3486635839}
3486735840#else
34868__ai int32x2_t vcvtm_s32_f32(float32x2_t __p0) {
34869 int32x2_t __ret;
34870 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
34871 __ret = (int32x2_t) __builtin_neon_vcvtm_s32_v((int8x8_t)__rev0, 2);
34872 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
35841__ai __attribute__((target("fullfp16"))) float16x8x2_t vzipq_f16(float16x8_t __p0, float16x8_t __p1) {
35842 float16x8x2_t __ret;
35843 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35844 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
35845 __builtin_neon_vzipq_f16(&__ret, (int8x16_t)__rev0, (int8x16_t)__rev1, 40);
35846
35847 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0);
35848 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0);
3487335849 return __ret;
3487435850}
3487535851#endif
3487635852
3487735853#ifdef __LITTLE_ENDIAN__
34878__ai uint32x4_t vcvtmq_u32_f32(float32x4_t __p0) {
35854__ai __attribute__((target("fullfp16"))) float16x4x2_t vzip_f16(float16x4_t __p0, float16x4_t __p1) {
35855 float16x4x2_t __ret;
35856 __builtin_neon_vzip_f16(&__ret, (int8x8_t)__p0, (int8x8_t)__p1, 8);
35857 return __ret;
35858}
35859#else
35860__ai __attribute__((target("fullfp16"))) float16x4x2_t vzip_f16(float16x4_t __p0, float16x4_t __p1) {
35861 float16x4x2_t __ret;
35862 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35863 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
35864 __builtin_neon_vzip_f16(&__ret, (int8x8_t)__rev0, (int8x8_t)__rev1, 8);
35865
35866 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0);
35867 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0);
35868 return __ret;
35869}
35870#endif
35871
35872#ifdef __LITTLE_ENDIAN__
35873__ai __attribute__((target("i8mm"))) uint32x4_t vmmlaq_u32(uint32x4_t __p0, uint8x16_t __p1, uint8x16_t __p2) {
3487935874 uint32x4_t __ret;
34880 __ret = (uint32x4_t) __builtin_neon_vcvtmq_u32_v((int8x16_t)__p0, 50);
35875 __ret = (uint32x4_t) __builtin_neon_vmmlaq_u32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 50);
3488135876 return __ret;
3488235877}
3488335878#else
34884__ai uint32x4_t vcvtmq_u32_f32(float32x4_t __p0) {
35879__ai __attribute__((target("i8mm"))) uint32x4_t vmmlaq_u32(uint32x4_t __p0, uint8x16_t __p1, uint8x16_t __p2) {
3488535880 uint32x4_t __ret;
34886 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34887 __ret = (uint32x4_t) __builtin_neon_vcvtmq_u32_v((int8x16_t)__rev0, 50);
35881 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35882 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
35883 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
35884 __ret = (uint32x4_t) __builtin_neon_vmmlaq_u32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 50);
3488835885 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3488935886 return __ret;
3489035887}
3489135888#endif
3489235889
3489335890#ifdef __LITTLE_ENDIAN__
34894__ai uint32x2_t vcvtm_u32_f32(float32x2_t __p0) {
34895 uint32x2_t __ret;
34896 __ret = (uint32x2_t) __builtin_neon_vcvtm_u32_v((int8x8_t)__p0, 18);
35891__ai __attribute__((target("i8mm"))) int32x4_t vmmlaq_s32(int32x4_t __p0, int8x16_t __p1, int8x16_t __p2) {
35892 int32x4_t __ret;
35893 __ret = (int32x4_t) __builtin_neon_vmmlaq_s32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 34);
3489735894 return __ret;
3489835895}
3489935896#else
34900__ai uint32x2_t vcvtm_u32_f32(float32x2_t __p0) {
34901 uint32x2_t __ret;
34902 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
34903 __ret = (uint32x2_t) __builtin_neon_vcvtm_u32_v((int8x8_t)__rev0, 18);
34904 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
35897__ai __attribute__((target("i8mm"))) int32x4_t vmmlaq_s32(int32x4_t __p0, int8x16_t __p1, int8x16_t __p2) {
35898 int32x4_t __ret;
35899 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35900 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
35901 int8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
35902 __ret = (int32x4_t) __builtin_neon_vmmlaq_s32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 34);
35903 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3490535904 return __ret;
3490635905}
3490735906#endif
3490835907
3490935908#ifdef __LITTLE_ENDIAN__
34910__ai int32x4_t vcvtnq_s32_f32(float32x4_t __p0) {
35909__ai __attribute__((target("i8mm"))) int32x4_t vusdotq_s32(int32x4_t __p0, uint8x16_t __p1, int8x16_t __p2) {
3491135910 int32x4_t __ret;
34912 __ret = (int32x4_t) __builtin_neon_vcvtnq_s32_v((int8x16_t)__p0, 34);
35911 __ret = (int32x4_t) __builtin_neon_vusdotq_s32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 34);
3491335912 return __ret;
3491435913}
3491535914#else
34916__ai int32x4_t vcvtnq_s32_f32(float32x4_t __p0) {
35915__ai __attribute__((target("i8mm"))) int32x4_t vusdotq_s32(int32x4_t __p0, uint8x16_t __p1, int8x16_t __p2) {
3491735916 int32x4_t __ret;
34918 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34919 __ret = (int32x4_t) __builtin_neon_vcvtnq_s32_v((int8x16_t)__rev0, 34);
35917 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35918 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
35919 int8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
35920 __ret = (int32x4_t) __builtin_neon_vusdotq_s32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 34);
3492035921 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3492135922 return __ret;
3492235923}
35924__ai __attribute__((target("i8mm"))) int32x4_t __noswap_vusdotq_s32(int32x4_t __p0, uint8x16_t __p1, int8x16_t __p2) {
35925 int32x4_t __ret;
35926 __ret = (int32x4_t) __builtin_neon_vusdotq_s32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 34);
35927 return __ret;
35928}
3492335929#endif
3492435930
3492535931#ifdef __LITTLE_ENDIAN__
34926__ai int32x2_t vcvtn_s32_f32(float32x2_t __p0) {
35932__ai __attribute__((target("i8mm"))) int32x2_t vusdot_s32(int32x2_t __p0, uint8x8_t __p1, int8x8_t __p2) {
3492735933 int32x2_t __ret;
34928 __ret = (int32x2_t) __builtin_neon_vcvtn_s32_v((int8x8_t)__p0, 2);
35934 __ret = (int32x2_t) __builtin_neon_vusdot_s32((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 2);
3492935935 return __ret;
3493035936}
3493135937#else
34932__ai int32x2_t vcvtn_s32_f32(float32x2_t __p0) {
35938__ai __attribute__((target("i8mm"))) int32x2_t vusdot_s32(int32x2_t __p0, uint8x8_t __p1, int8x8_t __p2) {
3493335939 int32x2_t __ret;
34934 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
34935 __ret = (int32x2_t) __builtin_neon_vcvtn_s32_v((int8x8_t)__rev0, 2);
35940 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
35941 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
35942 int8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
35943 __ret = (int32x2_t) __builtin_neon_vusdot_s32((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 2);
3493635944 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
3493735945 return __ret;
3493835946}
35947__ai __attribute__((target("i8mm"))) int32x2_t __noswap_vusdot_s32(int32x2_t __p0, uint8x8_t __p1, int8x8_t __p2) {
35948 int32x2_t __ret;
35949 __ret = (int32x2_t) __builtin_neon_vusdot_s32((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 2);
35950 return __ret;
35951}
3493935952#endif
3494035953
3494135954#ifdef __LITTLE_ENDIAN__
34942__ai uint32x4_t vcvtnq_u32_f32(float32x4_t __p0) {
34943 uint32x4_t __ret;
34944 __ret = (uint32x4_t) __builtin_neon_vcvtnq_u32_v((int8x16_t)__p0, 50);
35955#define vusdotq_lane_s32(__p0_157, __p1_157, __p2_157, __p3_157) __extension__ ({ \
35956 int32x4_t __ret_157; \
35957 int32x4_t __s0_157 = __p0_157; \
35958 uint8x16_t __s1_157 = __p1_157; \
35959 int8x8_t __s2_157 = __p2_157; \
35960int8x8_t __reint_157 = __s2_157; \
35961 __ret_157 = vusdotq_s32(__s0_157, __s1_157, (int8x16_t)(splatq_lane_s32(*(int32x2_t *) &__reint_157, __p3_157))); \
35962 __ret_157; \
35963})
35964#else
35965#define vusdotq_lane_s32(__p0_158, __p1_158, __p2_158, __p3_158) __extension__ ({ \
35966 int32x4_t __ret_158; \
35967 int32x4_t __s0_158 = __p0_158; \
35968 uint8x16_t __s1_158 = __p1_158; \
35969 int8x8_t __s2_158 = __p2_158; \
35970 int32x4_t __rev0_158; __rev0_158 = __builtin_shufflevector(__s0_158, __s0_158, 3, 2, 1, 0); \
35971 uint8x16_t __rev1_158; __rev1_158 = __builtin_shufflevector(__s1_158, __s1_158, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
35972 int8x8_t __rev2_158; __rev2_158 = __builtin_shufflevector(__s2_158, __s2_158, 7, 6, 5, 4, 3, 2, 1, 0); \
35973int8x8_t __reint_158 = __rev2_158; \
35974 __ret_158 = __noswap_vusdotq_s32(__rev0_158, __rev1_158, (int8x16_t)(__noswap_splatq_lane_s32(*(int32x2_t *) &__reint_158, __p3_158))); \
35975 __ret_158 = __builtin_shufflevector(__ret_158, __ret_158, 3, 2, 1, 0); \
35976 __ret_158; \
35977})
35978#endif
35979
35980#ifdef __LITTLE_ENDIAN__
35981#define vusdot_lane_s32(__p0_159, __p1_159, __p2_159, __p3_159) __extension__ ({ \
35982 int32x2_t __ret_159; \
35983 int32x2_t __s0_159 = __p0_159; \
35984 uint8x8_t __s1_159 = __p1_159; \
35985 int8x8_t __s2_159 = __p2_159; \
35986int8x8_t __reint_159 = __s2_159; \
35987 __ret_159 = vusdot_s32(__s0_159, __s1_159, (int8x8_t)(splat_lane_s32(*(int32x2_t *) &__reint_159, __p3_159))); \
35988 __ret_159; \
35989})
35990#else
35991#define vusdot_lane_s32(__p0_160, __p1_160, __p2_160, __p3_160) __extension__ ({ \
35992 int32x2_t __ret_160; \
35993 int32x2_t __s0_160 = __p0_160; \
35994 uint8x8_t __s1_160 = __p1_160; \
35995 int8x8_t __s2_160 = __p2_160; \
35996 int32x2_t __rev0_160; __rev0_160 = __builtin_shufflevector(__s0_160, __s0_160, 1, 0); \
35997 uint8x8_t __rev1_160; __rev1_160 = __builtin_shufflevector(__s1_160, __s1_160, 7, 6, 5, 4, 3, 2, 1, 0); \
35998 int8x8_t __rev2_160; __rev2_160 = __builtin_shufflevector(__s2_160, __s2_160, 7, 6, 5, 4, 3, 2, 1, 0); \
35999int8x8_t __reint_160 = __rev2_160; \
36000 __ret_160 = __noswap_vusdot_s32(__rev0_160, __rev1_160, (int8x8_t)(__noswap_splat_lane_s32(*(int32x2_t *) &__reint_160, __p3_160))); \
36001 __ret_160 = __builtin_shufflevector(__ret_160, __ret_160, 1, 0); \
36002 __ret_160; \
36003})
36004#endif
36005
36006#ifdef __LITTLE_ENDIAN__
36007__ai __attribute__((target("i8mm"))) int32x4_t vusmmlaq_s32(int32x4_t __p0, uint8x16_t __p1, int8x16_t __p2) {
36008 int32x4_t __ret;
36009 __ret = (int32x4_t) __builtin_neon_vusmmlaq_s32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 34);
3494536010 return __ret;
3494636011}
3494736012#else
34948__ai uint32x4_t vcvtnq_u32_f32(float32x4_t __p0) {
34949 uint32x4_t __ret;
34950 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34951 __ret = (uint32x4_t) __builtin_neon_vcvtnq_u32_v((int8x16_t)__rev0, 50);
36013__ai __attribute__((target("i8mm"))) int32x4_t vusmmlaq_s32(int32x4_t __p0, uint8x16_t __p1, int8x16_t __p2) {
36014 int32x4_t __ret;
36015 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
36016 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
36017 int8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
36018 __ret = (int32x4_t) __builtin_neon_vusmmlaq_s32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 34);
3495236019 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3495336020 return __ret;
3495436021}
3495536022#endif
3495636023
3495736024#ifdef __LITTLE_ENDIAN__
34958__ai uint32x2_t vcvtn_u32_f32(float32x2_t __p0) {
34959 uint32x2_t __ret;
34960 __ret = (uint32x2_t) __builtin_neon_vcvtn_u32_v((int8x8_t)__p0, 18);
36025__ai __attribute__((target("v8.1a"))) int32x4_t vqrdmlahq_s32(int32x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
36026 int32x4_t __ret;
36027 __ret = (int32x4_t) __builtin_neon_vqrdmlahq_s32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 34);
3496136028 return __ret;
3496236029}
3496336030#else
34964__ai uint32x2_t vcvtn_u32_f32(float32x2_t __p0) {
34965 uint32x2_t __ret;
34966 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
34967 __ret = (uint32x2_t) __builtin_neon_vcvtn_u32_v((int8x8_t)__rev0, 18);
34968 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
36031__ai __attribute__((target("v8.1a"))) int32x4_t vqrdmlahq_s32(int32x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
36032 int32x4_t __ret;
36033 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
36034 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
36035 int32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
36036 __ret = (int32x4_t) __builtin_neon_vqrdmlahq_s32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 34);
36037 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
36038 return __ret;
36039}
36040__ai __attribute__((target("v8.1a"))) int32x4_t __noswap_vqrdmlahq_s32(int32x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
36041 int32x4_t __ret;
36042 __ret = (int32x4_t) __builtin_neon_vqrdmlahq_s32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 34);
3496936043 return __ret;
3497036044}
3497136045#endif
3497236046
3497336047#ifdef __LITTLE_ENDIAN__
34974__ai int32x4_t vcvtpq_s32_f32(float32x4_t __p0) {
34975 int32x4_t __ret;
34976 __ret = (int32x4_t) __builtin_neon_vcvtpq_s32_v((int8x16_t)__p0, 34);
36048__ai __attribute__((target("v8.1a"))) int16x8_t vqrdmlahq_s16(int16x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
36049 int16x8_t __ret;
36050 __ret = (int16x8_t) __builtin_neon_vqrdmlahq_s16((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 33);
3497736051 return __ret;
3497836052}
3497936053#else
34980__ai int32x4_t vcvtpq_s32_f32(float32x4_t __p0) {
34981 int32x4_t __ret;
34982 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
34983 __ret = (int32x4_t) __builtin_neon_vcvtpq_s32_v((int8x16_t)__rev0, 34);
34984 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
36054__ai __attribute__((target("v8.1a"))) int16x8_t vqrdmlahq_s16(int16x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
36055 int16x8_t __ret;
36056 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
36057 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
36058 int16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
36059 __ret = (int16x8_t) __builtin_neon_vqrdmlahq_s16((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 33);
36060 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
36061 return __ret;
36062}
36063__ai __attribute__((target("v8.1a"))) int16x8_t __noswap_vqrdmlahq_s16(int16x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
36064 int16x8_t __ret;
36065 __ret = (int16x8_t) __builtin_neon_vqrdmlahq_s16((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 33);
3498536066 return __ret;
3498636067}
3498736068#endif
3498836069
3498936070#ifdef __LITTLE_ENDIAN__
34990__ai int32x2_t vcvtp_s32_f32(float32x2_t __p0) {
36071__ai __attribute__((target("v8.1a"))) int32x2_t vqrdmlah_s32(int32x2_t __p0, int32x2_t __p1, int32x2_t __p2) {
3499136072 int32x2_t __ret;
34992 __ret = (int32x2_t) __builtin_neon_vcvtp_s32_v((int8x8_t)__p0, 2);
36073 __ret = (int32x2_t) __builtin_neon_vqrdmlah_s32((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 2);
3499336074 return __ret;
3499436075}
3499536076#else
34996__ai int32x2_t vcvtp_s32_f32(float32x2_t __p0) {
36077__ai __attribute__((target("v8.1a"))) int32x2_t vqrdmlah_s32(int32x2_t __p0, int32x2_t __p1, int32x2_t __p2) {
3499736078 int32x2_t __ret;
34998 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
34999 __ret = (int32x2_t) __builtin_neon_vcvtp_s32_v((int8x8_t)__rev0, 2);
36079 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
36080 int32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
36081 int32x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
36082 __ret = (int32x2_t) __builtin_neon_vqrdmlah_s32((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 2);
3500036083 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
3500136084 return __ret;
3500236085}
36086__ai __attribute__((target("v8.1a"))) int32x2_t __noswap_vqrdmlah_s32(int32x2_t __p0, int32x2_t __p1, int32x2_t __p2) {
36087 int32x2_t __ret;
36088 __ret = (int32x2_t) __builtin_neon_vqrdmlah_s32((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 2);
36089 return __ret;
36090}
3500336091#endif
3500436092
3500536093#ifdef __LITTLE_ENDIAN__
35006__ai uint32x4_t vcvtpq_u32_f32(float32x4_t __p0) {
35007 uint32x4_t __ret;
35008 __ret = (uint32x4_t) __builtin_neon_vcvtpq_u32_v((int8x16_t)__p0, 50);
36094__ai __attribute__((target("v8.1a"))) int16x4_t vqrdmlah_s16(int16x4_t __p0, int16x4_t __p1, int16x4_t __p2) {
36095 int16x4_t __ret;
36096 __ret = (int16x4_t) __builtin_neon_vqrdmlah_s16((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 1);
3500936097 return __ret;
3501036098}
3501136099#else
35012__ai uint32x4_t vcvtpq_u32_f32(float32x4_t __p0) {
35013 uint32x4_t __ret;
35014 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35015 __ret = (uint32x4_t) __builtin_neon_vcvtpq_u32_v((int8x16_t)__rev0, 50);
36100__ai __attribute__((target("v8.1a"))) int16x4_t vqrdmlah_s16(int16x4_t __p0, int16x4_t __p1, int16x4_t __p2) {
36101 int16x4_t __ret;
36102 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
36103 int16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
36104 int16x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
36105 __ret = (int16x4_t) __builtin_neon_vqrdmlah_s16((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 1);
3501636106 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3501736107 return __ret;
3501836108}
36109__ai __attribute__((target("v8.1a"))) int16x4_t __noswap_vqrdmlah_s16(int16x4_t __p0, int16x4_t __p1, int16x4_t __p2) {
36110 int16x4_t __ret;
36111 __ret = (int16x4_t) __builtin_neon_vqrdmlah_s16((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 1);
36112 return __ret;
36113}
3501936114#endif
3502036115
3502136116#ifdef __LITTLE_ENDIAN__
35022__ai uint32x2_t vcvtp_u32_f32(float32x2_t __p0) {
35023 uint32x2_t __ret;
35024 __ret = (uint32x2_t) __builtin_neon_vcvtp_u32_v((int8x8_t)__p0, 18);
35025 return __ret;
35026}
36117#define vqrdmlahq_lane_s32(__p0_161, __p1_161, __p2_161, __p3_161) __extension__ ({ \
36118 int32x4_t __ret_161; \
36119 int32x4_t __s0_161 = __p0_161; \
36120 int32x4_t __s1_161 = __p1_161; \
36121 int32x2_t __s2_161 = __p2_161; \
36122 __ret_161 = vqrdmlahq_s32(__s0_161, __s1_161, splatq_lane_s32(__s2_161, __p3_161)); \
36123 __ret_161; \
36124})
3502736125#else
35028__ai uint32x2_t vcvtp_u32_f32(float32x2_t __p0) {
35029 uint32x2_t __ret;
35030 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
35031 __ret = (uint32x2_t) __builtin_neon_vcvtp_u32_v((int8x8_t)__rev0, 18);
35032 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
35033 return __ret;
35034}
36126#define vqrdmlahq_lane_s32(__p0_162, __p1_162, __p2_162, __p3_162) __extension__ ({ \
36127 int32x4_t __ret_162; \
36128 int32x4_t __s0_162 = __p0_162; \
36129 int32x4_t __s1_162 = __p1_162; \
36130 int32x2_t __s2_162 = __p2_162; \
36131 int32x4_t __rev0_162; __rev0_162 = __builtin_shufflevector(__s0_162, __s0_162, 3, 2, 1, 0); \
36132 int32x4_t __rev1_162; __rev1_162 = __builtin_shufflevector(__s1_162, __s1_162, 3, 2, 1, 0); \
36133 int32x2_t __rev2_162; __rev2_162 = __builtin_shufflevector(__s2_162, __s2_162, 1, 0); \
36134 __ret_162 = __noswap_vqrdmlahq_s32(__rev0_162, __rev1_162, __noswap_splatq_lane_s32(__rev2_162, __p3_162)); \
36135 __ret_162 = __builtin_shufflevector(__ret_162, __ret_162, 3, 2, 1, 0); \
36136 __ret_162; \
36137})
3503536138#endif
3503636139
35037#endif
35038#if __ARM_ARCH >= 8 && defined(__ARM_FEATURE_AES)
3503936140#ifdef __LITTLE_ENDIAN__
35040__ai uint8x16_t vaesdq_u8(uint8x16_t __p0, uint8x16_t __p1) {
35041 uint8x16_t __ret;
35042 __ret = (uint8x16_t) __builtin_neon_vaesdq_v((int8x16_t)__p0, (int8x16_t)__p1, 48);
35043 return __ret;
35044}
36141#define vqrdmlahq_lane_s16(__p0_163, __p1_163, __p2_163, __p3_163) __extension__ ({ \
36142 int16x8_t __ret_163; \
36143 int16x8_t __s0_163 = __p0_163; \
36144 int16x8_t __s1_163 = __p1_163; \
36145 int16x4_t __s2_163 = __p2_163; \
36146 __ret_163 = vqrdmlahq_s16(__s0_163, __s1_163, splatq_lane_s16(__s2_163, __p3_163)); \
36147 __ret_163; \
36148})
3504536149#else
35046__ai uint8x16_t vaesdq_u8(uint8x16_t __p0, uint8x16_t __p1) {
35047 uint8x16_t __ret;
35048 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
35049 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
35050 __ret = (uint8x16_t) __builtin_neon_vaesdq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 48);
35051 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
35052 return __ret;
35053}
36150#define vqrdmlahq_lane_s16(__p0_164, __p1_164, __p2_164, __p3_164) __extension__ ({ \
36151 int16x8_t __ret_164; \
36152 int16x8_t __s0_164 = __p0_164; \
36153 int16x8_t __s1_164 = __p1_164; \
36154 int16x4_t __s2_164 = __p2_164; \
36155 int16x8_t __rev0_164; __rev0_164 = __builtin_shufflevector(__s0_164, __s0_164, 7, 6, 5, 4, 3, 2, 1, 0); \
36156 int16x8_t __rev1_164; __rev1_164 = __builtin_shufflevector(__s1_164, __s1_164, 7, 6, 5, 4, 3, 2, 1, 0); \
36157 int16x4_t __rev2_164; __rev2_164 = __builtin_shufflevector(__s2_164, __s2_164, 3, 2, 1, 0); \
36158 __ret_164 = __noswap_vqrdmlahq_s16(__rev0_164, __rev1_164, __noswap_splatq_lane_s16(__rev2_164, __p3_164)); \
36159 __ret_164 = __builtin_shufflevector(__ret_164, __ret_164, 7, 6, 5, 4, 3, 2, 1, 0); \
36160 __ret_164; \
36161})
3505436162#endif
3505536163
3505636164#ifdef __LITTLE_ENDIAN__
35057__ai uint8x16_t vaeseq_u8(uint8x16_t __p0, uint8x16_t __p1) {
35058 uint8x16_t __ret;
35059 __ret = (uint8x16_t) __builtin_neon_vaeseq_v((int8x16_t)__p0, (int8x16_t)__p1, 48);
35060 return __ret;
35061}
36165#define vqrdmlah_lane_s32(__p0_165, __p1_165, __p2_165, __p3_165) __extension__ ({ \
36166 int32x2_t __ret_165; \
36167 int32x2_t __s0_165 = __p0_165; \
36168 int32x2_t __s1_165 = __p1_165; \
36169 int32x2_t __s2_165 = __p2_165; \
36170 __ret_165 = vqrdmlah_s32(__s0_165, __s1_165, splat_lane_s32(__s2_165, __p3_165)); \
36171 __ret_165; \
36172})
3506236173#else
35063__ai uint8x16_t vaeseq_u8(uint8x16_t __p0, uint8x16_t __p1) {
35064 uint8x16_t __ret;
35065 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
35066 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
35067 __ret = (uint8x16_t) __builtin_neon_vaeseq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 48);
35068 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
35069 return __ret;
35070}
36174#define vqrdmlah_lane_s32(__p0_166, __p1_166, __p2_166, __p3_166) __extension__ ({ \
36175 int32x2_t __ret_166; \
36176 int32x2_t __s0_166 = __p0_166; \
36177 int32x2_t __s1_166 = __p1_166; \
36178 int32x2_t __s2_166 = __p2_166; \
36179 int32x2_t __rev0_166; __rev0_166 = __builtin_shufflevector(__s0_166, __s0_166, 1, 0); \
36180 int32x2_t __rev1_166; __rev1_166 = __builtin_shufflevector(__s1_166, __s1_166, 1, 0); \
36181 int32x2_t __rev2_166; __rev2_166 = __builtin_shufflevector(__s2_166, __s2_166, 1, 0); \
36182 __ret_166 = __noswap_vqrdmlah_s32(__rev0_166, __rev1_166, __noswap_splat_lane_s32(__rev2_166, __p3_166)); \
36183 __ret_166 = __builtin_shufflevector(__ret_166, __ret_166, 1, 0); \
36184 __ret_166; \
36185})
3507136186#endif
3507236187
3507336188#ifdef __LITTLE_ENDIAN__
35074__ai uint8x16_t vaesimcq_u8(uint8x16_t __p0) {
35075 uint8x16_t __ret;
35076 __ret = (uint8x16_t) __builtin_neon_vaesimcq_v((int8x16_t)__p0, 48);
35077 return __ret;
35078}
36189#define vqrdmlah_lane_s16(__p0_167, __p1_167, __p2_167, __p3_167) __extension__ ({ \
36190 int16x4_t __ret_167; \
36191 int16x4_t __s0_167 = __p0_167; \
36192 int16x4_t __s1_167 = __p1_167; \
36193 int16x4_t __s2_167 = __p2_167; \
36194 __ret_167 = vqrdmlah_s16(__s0_167, __s1_167, splat_lane_s16(__s2_167, __p3_167)); \
36195 __ret_167; \
36196})
3507936197#else
35080__ai uint8x16_t vaesimcq_u8(uint8x16_t __p0) {
35081 uint8x16_t __ret;
35082 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
35083 __ret = (uint8x16_t) __builtin_neon_vaesimcq_v((int8x16_t)__rev0, 48);
35084 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
35085 return __ret;
35086}
36198#define vqrdmlah_lane_s16(__p0_168, __p1_168, __p2_168, __p3_168) __extension__ ({ \
36199 int16x4_t __ret_168; \
36200 int16x4_t __s0_168 = __p0_168; \
36201 int16x4_t __s1_168 = __p1_168; \
36202 int16x4_t __s2_168 = __p2_168; \
36203 int16x4_t __rev0_168; __rev0_168 = __builtin_shufflevector(__s0_168, __s0_168, 3, 2, 1, 0); \
36204 int16x4_t __rev1_168; __rev1_168 = __builtin_shufflevector(__s1_168, __s1_168, 3, 2, 1, 0); \
36205 int16x4_t __rev2_168; __rev2_168 = __builtin_shufflevector(__s2_168, __s2_168, 3, 2, 1, 0); \
36206 __ret_168 = __noswap_vqrdmlah_s16(__rev0_168, __rev1_168, __noswap_splat_lane_s16(__rev2_168, __p3_168)); \
36207 __ret_168 = __builtin_shufflevector(__ret_168, __ret_168, 3, 2, 1, 0); \
36208 __ret_168; \
36209})
3508736210#endif
3508836211
3508936212#ifdef __LITTLE_ENDIAN__
35090__ai uint8x16_t vaesmcq_u8(uint8x16_t __p0) {
35091 uint8x16_t __ret;
35092 __ret = (uint8x16_t) __builtin_neon_vaesmcq_v((int8x16_t)__p0, 48);
36213__ai __attribute__((target("v8.1a"))) int32x4_t vqrdmlshq_s32(int32x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
36214 int32x4_t __ret;
36215 __ret = (int32x4_t) __builtin_neon_vqrdmlshq_s32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 34);
3509336216 return __ret;
3509436217}
3509536218#else
35096__ai uint8x16_t vaesmcq_u8(uint8x16_t __p0) {
35097 uint8x16_t __ret;
35098 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
35099 __ret = (uint8x16_t) __builtin_neon_vaesmcq_v((int8x16_t)__rev0, 48);
35100 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
36219__ai __attribute__((target("v8.1a"))) int32x4_t vqrdmlshq_s32(int32x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
36220 int32x4_t __ret;
36221 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
36222 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
36223 int32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
36224 __ret = (int32x4_t) __builtin_neon_vqrdmlshq_s32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 34);
36225 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
36226 return __ret;
36227}
36228__ai __attribute__((target("v8.1a"))) int32x4_t __noswap_vqrdmlshq_s32(int32x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
36229 int32x4_t __ret;
36230 __ret = (int32x4_t) __builtin_neon_vqrdmlshq_s32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 34);
3510136231 return __ret;
3510236232}
3510336233#endif
3510436234
35105#endif
35106#if __ARM_ARCH >= 8 && defined(__ARM_FEATURE_DIRECTED_ROUNDING)
3510736235#ifdef __LITTLE_ENDIAN__
35108__ai float32x4_t vrndq_f32(float32x4_t __p0) {
35109 float32x4_t __ret;
35110 __ret = (float32x4_t) __builtin_neon_vrndq_v((int8x16_t)__p0, 41);
36236__ai __attribute__((target("v8.1a"))) int16x8_t vqrdmlshq_s16(int16x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
36237 int16x8_t __ret;
36238 __ret = (int16x8_t) __builtin_neon_vqrdmlshq_s16((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 33);
3511136239 return __ret;
3511236240}
3511336241#else
35114__ai float32x4_t vrndq_f32(float32x4_t __p0) {
35115 float32x4_t __ret;
35116 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35117 __ret = (float32x4_t) __builtin_neon_vrndq_v((int8x16_t)__rev0, 41);
35118 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
36242__ai __attribute__((target("v8.1a"))) int16x8_t vqrdmlshq_s16(int16x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
36243 int16x8_t __ret;
36244 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
36245 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
36246 int16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
36247 __ret = (int16x8_t) __builtin_neon_vqrdmlshq_s16((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 33);
36248 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
36249 return __ret;
36250}
36251__ai __attribute__((target("v8.1a"))) int16x8_t __noswap_vqrdmlshq_s16(int16x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
36252 int16x8_t __ret;
36253 __ret = (int16x8_t) __builtin_neon_vqrdmlshq_s16((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 33);
3511936254 return __ret;
3512036255}
3512136256#endif
3512236257
3512336258#ifdef __LITTLE_ENDIAN__
35124__ai float32x2_t vrnd_f32(float32x2_t __p0) {
35125 float32x2_t __ret;
35126 __ret = (float32x2_t) __builtin_neon_vrnd_v((int8x8_t)__p0, 9);
36259__ai __attribute__((target("v8.1a"))) int32x2_t vqrdmlsh_s32(int32x2_t __p0, int32x2_t __p1, int32x2_t __p2) {
36260 int32x2_t __ret;
36261 __ret = (int32x2_t) __builtin_neon_vqrdmlsh_s32((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 2);
3512736262 return __ret;
3512836263}
3512936264#else
35130__ai float32x2_t vrnd_f32(float32x2_t __p0) {
35131 float32x2_t __ret;
35132 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
35133 __ret = (float32x2_t) __builtin_neon_vrnd_v((int8x8_t)__rev0, 9);
36265__ai __attribute__((target("v8.1a"))) int32x2_t vqrdmlsh_s32(int32x2_t __p0, int32x2_t __p1, int32x2_t __p2) {
36266 int32x2_t __ret;
36267 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
36268 int32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
36269 int32x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
36270 __ret = (int32x2_t) __builtin_neon_vqrdmlsh_s32((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 2);
3513436271 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
3513536272 return __ret;
3513636273}
36274__ai __attribute__((target("v8.1a"))) int32x2_t __noswap_vqrdmlsh_s32(int32x2_t __p0, int32x2_t __p1, int32x2_t __p2) {
36275 int32x2_t __ret;
36276 __ret = (int32x2_t) __builtin_neon_vqrdmlsh_s32((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 2);
36277 return __ret;
36278}
3513736279#endif
3513836280
3513936281#ifdef __LITTLE_ENDIAN__
35140__ai float32x4_t vrndaq_f32(float32x4_t __p0) {
35141 float32x4_t __ret;
35142 __ret = (float32x4_t) __builtin_neon_vrndaq_v((int8x16_t)__p0, 41);
36282__ai __attribute__((target("v8.1a"))) int16x4_t vqrdmlsh_s16(int16x4_t __p0, int16x4_t __p1, int16x4_t __p2) {
36283 int16x4_t __ret;
36284 __ret = (int16x4_t) __builtin_neon_vqrdmlsh_s16((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 1);
3514336285 return __ret;
3514436286}
3514536287#else
35146__ai float32x4_t vrndaq_f32(float32x4_t __p0) {
35147 float32x4_t __ret;
35148 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35149 __ret = (float32x4_t) __builtin_neon_vrndaq_v((int8x16_t)__rev0, 41);
36288__ai __attribute__((target("v8.1a"))) int16x4_t vqrdmlsh_s16(int16x4_t __p0, int16x4_t __p1, int16x4_t __p2) {
36289 int16x4_t __ret;
36290 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
36291 int16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
36292 int16x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
36293 __ret = (int16x4_t) __builtin_neon_vqrdmlsh_s16((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 1);
3515036294 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3515136295 return __ret;
3515236296}
36297__ai __attribute__((target("v8.1a"))) int16x4_t __noswap_vqrdmlsh_s16(int16x4_t __p0, int16x4_t __p1, int16x4_t __p2) {
36298 int16x4_t __ret;
36299 __ret = (int16x4_t) __builtin_neon_vqrdmlsh_s16((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 1);
36300 return __ret;
36301}
3515336302#endif
3515436303
3515536304#ifdef __LITTLE_ENDIAN__
35156__ai float32x2_t vrnda_f32(float32x2_t __p0) {
35157 float32x2_t __ret;
35158 __ret = (float32x2_t) __builtin_neon_vrnda_v((int8x8_t)__p0, 9);
35159 return __ret;
35160}
36305#define vqrdmlshq_lane_s32(__p0_169, __p1_169, __p2_169, __p3_169) __extension__ ({ \
36306 int32x4_t __ret_169; \
36307 int32x4_t __s0_169 = __p0_169; \
36308 int32x4_t __s1_169 = __p1_169; \
36309 int32x2_t __s2_169 = __p2_169; \
36310 __ret_169 = vqrdmlshq_s32(__s0_169, __s1_169, splatq_lane_s32(__s2_169, __p3_169)); \
36311 __ret_169; \
36312})
3516136313#else
35162__ai float32x2_t vrnda_f32(float32x2_t __p0) {
35163 float32x2_t __ret;
35164 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
35165 __ret = (float32x2_t) __builtin_neon_vrnda_v((int8x8_t)__rev0, 9);
35166 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
35167 return __ret;
35168}
36314#define vqrdmlshq_lane_s32(__p0_170, __p1_170, __p2_170, __p3_170) __extension__ ({ \
36315 int32x4_t __ret_170; \
36316 int32x4_t __s0_170 = __p0_170; \
36317 int32x4_t __s1_170 = __p1_170; \
36318 int32x2_t __s2_170 = __p2_170; \
36319 int32x4_t __rev0_170; __rev0_170 = __builtin_shufflevector(__s0_170, __s0_170, 3, 2, 1, 0); \
36320 int32x4_t __rev1_170; __rev1_170 = __builtin_shufflevector(__s1_170, __s1_170, 3, 2, 1, 0); \
36321 int32x2_t __rev2_170; __rev2_170 = __builtin_shufflevector(__s2_170, __s2_170, 1, 0); \
36322 __ret_170 = __noswap_vqrdmlshq_s32(__rev0_170, __rev1_170, __noswap_splatq_lane_s32(__rev2_170, __p3_170)); \
36323 __ret_170 = __builtin_shufflevector(__ret_170, __ret_170, 3, 2, 1, 0); \
36324 __ret_170; \
36325})
3516936326#endif
3517036327
3517136328#ifdef __LITTLE_ENDIAN__
35172__ai float32x4_t vrndiq_f32(float32x4_t __p0) {
35173 float32x4_t __ret;
35174 __ret = (float32x4_t) __builtin_neon_vrndiq_v((int8x16_t)__p0, 41);
35175 return __ret;
35176}
36329#define vqrdmlshq_lane_s16(__p0_171, __p1_171, __p2_171, __p3_171) __extension__ ({ \
36330 int16x8_t __ret_171; \
36331 int16x8_t __s0_171 = __p0_171; \
36332 int16x8_t __s1_171 = __p1_171; \
36333 int16x4_t __s2_171 = __p2_171; \
36334 __ret_171 = vqrdmlshq_s16(__s0_171, __s1_171, splatq_lane_s16(__s2_171, __p3_171)); \
36335 __ret_171; \
36336})
3517736337#else
35178__ai float32x4_t vrndiq_f32(float32x4_t __p0) {
35179 float32x4_t __ret;
35180 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35181 __ret = (float32x4_t) __builtin_neon_vrndiq_v((int8x16_t)__rev0, 41);
35182 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35183 return __ret;
35184}
36338#define vqrdmlshq_lane_s16(__p0_172, __p1_172, __p2_172, __p3_172) __extension__ ({ \
36339 int16x8_t __ret_172; \
36340 int16x8_t __s0_172 = __p0_172; \
36341 int16x8_t __s1_172 = __p1_172; \
36342 int16x4_t __s2_172 = __p2_172; \
36343 int16x8_t __rev0_172; __rev0_172 = __builtin_shufflevector(__s0_172, __s0_172, 7, 6, 5, 4, 3, 2, 1, 0); \
36344 int16x8_t __rev1_172; __rev1_172 = __builtin_shufflevector(__s1_172, __s1_172, 7, 6, 5, 4, 3, 2, 1, 0); \
36345 int16x4_t __rev2_172; __rev2_172 = __builtin_shufflevector(__s2_172, __s2_172, 3, 2, 1, 0); \
36346 __ret_172 = __noswap_vqrdmlshq_s16(__rev0_172, __rev1_172, __noswap_splatq_lane_s16(__rev2_172, __p3_172)); \
36347 __ret_172 = __builtin_shufflevector(__ret_172, __ret_172, 7, 6, 5, 4, 3, 2, 1, 0); \
36348 __ret_172; \
36349})
3518536350#endif
3518636351
3518736352#ifdef __LITTLE_ENDIAN__
35188__ai float32x2_t vrndi_f32(float32x2_t __p0) {
35189 float32x2_t __ret;
35190 __ret = (float32x2_t) __builtin_neon_vrndi_v((int8x8_t)__p0, 9);
35191 return __ret;
35192}
36353#define vqrdmlsh_lane_s32(__p0_173, __p1_173, __p2_173, __p3_173) __extension__ ({ \
36354 int32x2_t __ret_173; \
36355 int32x2_t __s0_173 = __p0_173; \
36356 int32x2_t __s1_173 = __p1_173; \
36357 int32x2_t __s2_173 = __p2_173; \
36358 __ret_173 = vqrdmlsh_s32(__s0_173, __s1_173, splat_lane_s32(__s2_173, __p3_173)); \
36359 __ret_173; \
36360})
3519336361#else
35194__ai float32x2_t vrndi_f32(float32x2_t __p0) {
35195 float32x2_t __ret;
35196 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
35197 __ret = (float32x2_t) __builtin_neon_vrndi_v((int8x8_t)__rev0, 9);
35198 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
35199 return __ret;
35200}
36362#define vqrdmlsh_lane_s32(__p0_174, __p1_174, __p2_174, __p3_174) __extension__ ({ \
36363 int32x2_t __ret_174; \
36364 int32x2_t __s0_174 = __p0_174; \
36365 int32x2_t __s1_174 = __p1_174; \
36366 int32x2_t __s2_174 = __p2_174; \
36367 int32x2_t __rev0_174; __rev0_174 = __builtin_shufflevector(__s0_174, __s0_174, 1, 0); \
36368 int32x2_t __rev1_174; __rev1_174 = __builtin_shufflevector(__s1_174, __s1_174, 1, 0); \
36369 int32x2_t __rev2_174; __rev2_174 = __builtin_shufflevector(__s2_174, __s2_174, 1, 0); \
36370 __ret_174 = __noswap_vqrdmlsh_s32(__rev0_174, __rev1_174, __noswap_splat_lane_s32(__rev2_174, __p3_174)); \
36371 __ret_174 = __builtin_shufflevector(__ret_174, __ret_174, 1, 0); \
36372 __ret_174; \
36373})
3520136374#endif
3520236375
3520336376#ifdef __LITTLE_ENDIAN__
35204__ai float32x4_t vrndmq_f32(float32x4_t __p0) {
35205 float32x4_t __ret;
35206 __ret = (float32x4_t) __builtin_neon_vrndmq_v((int8x16_t)__p0, 41);
35207 return __ret;
35208}
36377#define vqrdmlsh_lane_s16(__p0_175, __p1_175, __p2_175, __p3_175) __extension__ ({ \
36378 int16x4_t __ret_175; \
36379 int16x4_t __s0_175 = __p0_175; \
36380 int16x4_t __s1_175 = __p1_175; \
36381 int16x4_t __s2_175 = __p2_175; \
36382 __ret_175 = vqrdmlsh_s16(__s0_175, __s1_175, splat_lane_s16(__s2_175, __p3_175)); \
36383 __ret_175; \
36384})
3520936385#else
35210__ai float32x4_t vrndmq_f32(float32x4_t __p0) {
35211 float32x4_t __ret;
35212 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35213 __ret = (float32x4_t) __builtin_neon_vrndmq_v((int8x16_t)__rev0, 41);
35214 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35215 return __ret;
35216}
36386#define vqrdmlsh_lane_s16(__p0_176, __p1_176, __p2_176, __p3_176) __extension__ ({ \
36387 int16x4_t __ret_176; \
36388 int16x4_t __s0_176 = __p0_176; \
36389 int16x4_t __s1_176 = __p1_176; \
36390 int16x4_t __s2_176 = __p2_176; \
36391 int16x4_t __rev0_176; __rev0_176 = __builtin_shufflevector(__s0_176, __s0_176, 3, 2, 1, 0); \
36392 int16x4_t __rev1_176; __rev1_176 = __builtin_shufflevector(__s1_176, __s1_176, 3, 2, 1, 0); \
36393 int16x4_t __rev2_176; __rev2_176 = __builtin_shufflevector(__s2_176, __s2_176, 3, 2, 1, 0); \
36394 __ret_176 = __noswap_vqrdmlsh_s16(__rev0_176, __rev1_176, __noswap_splat_lane_s16(__rev2_176, __p3_176)); \
36395 __ret_176 = __builtin_shufflevector(__ret_176, __ret_176, 3, 2, 1, 0); \
36396 __ret_176; \
36397})
3521736398#endif
3521836399
3521936400#ifdef __LITTLE_ENDIAN__
35220__ai float32x2_t vrndm_f32(float32x2_t __p0) {
36401__ai __attribute__((target("v8.3a"))) float32x2_t vcadd_rot270_f32(float32x2_t __p0, float32x2_t __p1) {
3522136402 float32x2_t __ret;
35222 __ret = (float32x2_t) __builtin_neon_vrndm_v((int8x8_t)__p0, 9);
36403 __ret = (float32x2_t) __builtin_neon_vcadd_rot270_f32((int8x8_t)__p0, (int8x8_t)__p1, 9);
3522336404 return __ret;
3522436405}
3522536406#else
35226__ai float32x2_t vrndm_f32(float32x2_t __p0) {
36407__ai __attribute__((target("v8.3a"))) float32x2_t vcadd_rot270_f32(float32x2_t __p0, float32x2_t __p1) {
3522736408 float32x2_t __ret;
3522836409 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
35229 __ret = (float32x2_t) __builtin_neon_vrndm_v((int8x8_t)__rev0, 9);
36410 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
36411 __ret = (float32x2_t) __builtin_neon_vcadd_rot270_f32((int8x8_t)__rev0, (int8x8_t)__rev1, 9);
3523036412 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
3523136413 return __ret;
3523236414}
3523336415#endif
3523436416
3523536417#ifdef __LITTLE_ENDIAN__
35236__ai float32x4_t vrndnq_f32(float32x4_t __p0) {
35237 float32x4_t __ret;
35238 __ret = (float32x4_t) __builtin_neon_vrndnq_v((int8x16_t)__p0, 41);
35239 return __ret;
35240}
35241#else
35242__ai float32x4_t vrndnq_f32(float32x4_t __p0) {
35243 float32x4_t __ret;
35244 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35245 __ret = (float32x4_t) __builtin_neon_vrndnq_v((int8x16_t)__rev0, 41);
35246 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35247 return __ret;
35248}
35249#endif
35250
35251#ifdef __LITTLE_ENDIAN__
35252__ai float32x2_t vrndn_f32(float32x2_t __p0) {
36418__ai __attribute__((target("v8.3a"))) float32x2_t vcadd_rot90_f32(float32x2_t __p0, float32x2_t __p1) {
3525336419 float32x2_t __ret;
35254 __ret = (float32x2_t) __builtin_neon_vrndn_v((int8x8_t)__p0, 9);
36420 __ret = (float32x2_t) __builtin_neon_vcadd_rot90_f32((int8x8_t)__p0, (int8x8_t)__p1, 9);
3525536421 return __ret;
3525636422}
3525736423#else
35258__ai float32x2_t vrndn_f32(float32x2_t __p0) {
36424__ai __attribute__((target("v8.3a"))) float32x2_t vcadd_rot90_f32(float32x2_t __p0, float32x2_t __p1) {
3525936425 float32x2_t __ret;
3526036426 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
35261 __ret = (float32x2_t) __builtin_neon_vrndn_v((int8x8_t)__rev0, 9);
36427 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
36428 __ret = (float32x2_t) __builtin_neon_vcadd_rot90_f32((int8x8_t)__rev0, (int8x8_t)__rev1, 9);
3526236429 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
3526336430 return __ret;
3526436431}
3526536432#endif
3526636433
35267__ai float32_t vrndns_f32(float32_t __p0) {
35268 float32_t __ret;
35269 __ret = (float32_t) __builtin_neon_vrndns_f32(__p0);
35270 return __ret;
35271}
3527236434#ifdef __LITTLE_ENDIAN__
35273__ai float32x4_t vrndpq_f32(float32x4_t __p0) {
36435__ai __attribute__((target("v8.3a"))) float32x4_t vcaddq_rot270_f32(float32x4_t __p0, float32x4_t __p1) {
3527436436 float32x4_t __ret;
35275 __ret = (float32x4_t) __builtin_neon_vrndpq_v((int8x16_t)__p0, 41);
36437 __ret = (float32x4_t) __builtin_neon_vcaddq_rot270_f32((int8x16_t)__p0, (int8x16_t)__p1, 41);
3527636438 return __ret;
3527736439}
3527836440#else
35279__ai float32x4_t vrndpq_f32(float32x4_t __p0) {
36441__ai __attribute__((target("v8.3a"))) float32x4_t vcaddq_rot270_f32(float32x4_t __p0, float32x4_t __p1) {
3528036442 float32x4_t __ret;
3528136443 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35282 __ret = (float32x4_t) __builtin_neon_vrndpq_v((int8x16_t)__rev0, 41);
36444 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
36445 __ret = (float32x4_t) __builtin_neon_vcaddq_rot270_f32((int8x16_t)__rev0, (int8x16_t)__rev1, 41);
3528336446 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3528436447 return __ret;
3528536448}
3528636449#endif
3528736450
3528836451#ifdef __LITTLE_ENDIAN__
35289__ai float32x2_t vrndp_f32(float32x2_t __p0) {
35290 float32x2_t __ret;
35291 __ret = (float32x2_t) __builtin_neon_vrndp_v((int8x8_t)__p0, 9);
36452__ai __attribute__((target("v8.3a"))) float32x4_t vcaddq_rot90_f32(float32x4_t __p0, float32x4_t __p1) {
36453 float32x4_t __ret;
36454 __ret = (float32x4_t) __builtin_neon_vcaddq_rot90_f32((int8x16_t)__p0, (int8x16_t)__p1, 41);
3529236455 return __ret;
3529336456}
3529436457#else
35295__ai float32x2_t vrndp_f32(float32x2_t __p0) {
35296 float32x2_t __ret;
35297 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
35298 __ret = (float32x2_t) __builtin_neon_vrndp_v((int8x8_t)__rev0, 9);
35299 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
36458__ai __attribute__((target("v8.3a"))) float32x4_t vcaddq_rot90_f32(float32x4_t __p0, float32x4_t __p1) {
36459 float32x4_t __ret;
36460 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
36461 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
36462 __ret = (float32x4_t) __builtin_neon_vcaddq_rot90_f32((int8x16_t)__rev0, (int8x16_t)__rev1, 41);
36463 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3530036464 return __ret;
3530136465}
3530236466#endif
3530336467
3530436468#ifdef __LITTLE_ENDIAN__
35305__ai float32x4_t vrndxq_f32(float32x4_t __p0) {
36469__ai __attribute__((target("v8.3a"))) float32x4_t vcmlaq_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
3530636470 float32x4_t __ret;
35307 __ret = (float32x4_t) __builtin_neon_vrndxq_v((int8x16_t)__p0, 41);
36471 __ret = (float32x4_t) __builtin_neon_vcmlaq_f32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
3530836472 return __ret;
3530936473}
3531036474#else
35311__ai float32x4_t vrndxq_f32(float32x4_t __p0) {
36475__ai __attribute__((target("v8.3a"))) float32x4_t vcmlaq_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
3531236476 float32x4_t __ret;
3531336477 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35314 __ret = (float32x4_t) __builtin_neon_vrndxq_v((int8x16_t)__rev0, 41);
36478 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
36479 float32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
36480 __ret = (float32x4_t) __builtin_neon_vcmlaq_f32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 41);
3531536481 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3531636482 return __ret;
3531736483}
36484__ai __attribute__((target("v8.3a"))) float32x4_t __noswap_vcmlaq_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
36485 float32x4_t __ret;
36486 __ret = (float32x4_t) __builtin_neon_vcmlaq_f32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
36487 return __ret;
36488}
3531836489#endif
3531936490
3532036491#ifdef __LITTLE_ENDIAN__
35321__ai float32x2_t vrndx_f32(float32x2_t __p0) {
36492__ai __attribute__((target("v8.3a"))) float32x2_t vcmla_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
3532236493 float32x2_t __ret;
35323 __ret = (float32x2_t) __builtin_neon_vrndx_v((int8x8_t)__p0, 9);
36494 __ret = (float32x2_t) __builtin_neon_vcmla_f32((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
3532436495 return __ret;
3532536496}
3532636497#else
35327__ai float32x2_t vrndx_f32(float32x2_t __p0) {
36498__ai __attribute__((target("v8.3a"))) float32x2_t vcmla_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
3532836499 float32x2_t __ret;
3532936500 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
35330 __ret = (float32x2_t) __builtin_neon_vrndx_v((int8x8_t)__rev0, 9);
36501 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
36502 float32x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
36503 __ret = (float32x2_t) __builtin_neon_vcmla_f32((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 9);
3533136504 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
3533236505 return __ret;
3533336506}
35334#endif
35335
35336#endif
35337#if __ARM_ARCH >= 8 && defined(__ARM_FEATURE_DIRECTED_ROUNDING) && defined(__ARM_FEATURE_FP16_VECTOR_ARITHMETIC)
35338#ifdef __LITTLE_ENDIAN__
35339__ai float16x8_t vrndq_f16(float16x8_t __p0) {
35340 float16x8_t __ret;
35341 __ret = (float16x8_t) __builtin_neon_vrndq_v((int8x16_t)__p0, 40);
35342 return __ret;
35343}
35344#else
35345__ai float16x8_t vrndq_f16(float16x8_t __p0) {
35346 float16x8_t __ret;
35347 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35348 __ret = (float16x8_t) __builtin_neon_vrndq_v((int8x16_t)__rev0, 40);
35349 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
36507__ai __attribute__((target("v8.3a"))) float32x2_t __noswap_vcmla_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
36508 float32x2_t __ret;
36509 __ret = (float32x2_t) __builtin_neon_vcmla_f32((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
3535036510 return __ret;
3535136511}
3535236512#endif
3535336513
3535436514#ifdef __LITTLE_ENDIAN__
35355__ai float16x4_t vrnd_f16(float16x4_t __p0) {
35356 float16x4_t __ret;
35357 __ret = (float16x4_t) __builtin_neon_vrnd_v((int8x8_t)__p0, 8);
35358 return __ret;
35359}
36515#define vcmla_lane_f32(__p0_177, __p1_177, __p2_177, __p3_177) __extension__ ({ \
36516 float32x2_t __ret_177; \
36517 float32x2_t __s0_177 = __p0_177; \
36518 float32x2_t __s1_177 = __p1_177; \
36519 float32x2_t __s2_177 = __p2_177; \
36520float32x2_t __reint_177 = __s2_177; \
36521uint64x1_t __reint1_177 = (uint64x1_t) {vget_lane_u64(*(uint64x1_t *) &__reint_177, __p3_177)}; \
36522 __ret_177 = vcmla_f32(__s0_177, __s1_177, *(float32x2_t *) &__reint1_177); \
36523 __ret_177; \
36524})
3536036525#else
35361__ai float16x4_t vrnd_f16(float16x4_t __p0) {
35362 float16x4_t __ret;
35363 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35364 __ret = (float16x4_t) __builtin_neon_vrnd_v((int8x8_t)__rev0, 8);
35365 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35366 return __ret;
35367}
36526#define vcmla_lane_f32(__p0_178, __p1_178, __p2_178, __p3_178) __extension__ ({ \
36527 float32x2_t __ret_178; \
36528 float32x2_t __s0_178 = __p0_178; \
36529 float32x2_t __s1_178 = __p1_178; \
36530 float32x2_t __s2_178 = __p2_178; \
36531 float32x2_t __rev0_178; __rev0_178 = __builtin_shufflevector(__s0_178, __s0_178, 1, 0); \
36532 float32x2_t __rev1_178; __rev1_178 = __builtin_shufflevector(__s1_178, __s1_178, 1, 0); \
36533 float32x2_t __rev2_178; __rev2_178 = __builtin_shufflevector(__s2_178, __s2_178, 1, 0); \
36534float32x2_t __reint_178 = __rev2_178; \
36535uint64x1_t __reint1_178 = (uint64x1_t) {vget_lane_u64(*(uint64x1_t *) &__reint_178, __p3_178)}; \
36536 __ret_178 = __noswap_vcmla_f32(__rev0_178, __rev1_178, *(float32x2_t *) &__reint1_178); \
36537 __ret_178 = __builtin_shufflevector(__ret_178, __ret_178, 1, 0); \
36538 __ret_178; \
36539})
3536836540#endif
3536936541
3537036542#ifdef __LITTLE_ENDIAN__
35371__ai float16x8_t vrndaq_f16(float16x8_t __p0) {
35372 float16x8_t __ret;
35373 __ret = (float16x8_t) __builtin_neon_vrndaq_v((int8x16_t)__p0, 40);
35374 return __ret;
35375}
36543#define vcmlaq_lane_f32(__p0_179, __p1_179, __p2_179, __p3_179) __extension__ ({ \
36544 float32x4_t __ret_179; \
36545 float32x4_t __s0_179 = __p0_179; \
36546 float32x4_t __s1_179 = __p1_179; \
36547 float32x2_t __s2_179 = __p2_179; \
36548float32x2_t __reint_179 = __s2_179; \
36549uint64x2_t __reint1_179 = (uint64x2_t) {vget_lane_u64(*(uint64x1_t *) &__reint_179, __p3_179), vget_lane_u64(*(uint64x1_t *) &__reint_179, __p3_179)}; \
36550 __ret_179 = vcmlaq_f32(__s0_179, __s1_179, *(float32x4_t *) &__reint1_179); \
36551 __ret_179; \
36552})
3537636553#else
35377__ai float16x8_t vrndaq_f16(float16x8_t __p0) {
35378 float16x8_t __ret;
35379 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35380 __ret = (float16x8_t) __builtin_neon_vrndaq_v((int8x16_t)__rev0, 40);
35381 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
35382 return __ret;
35383}
36554#define vcmlaq_lane_f32(__p0_180, __p1_180, __p2_180, __p3_180) __extension__ ({ \
36555 float32x4_t __ret_180; \
36556 float32x4_t __s0_180 = __p0_180; \
36557 float32x4_t __s1_180 = __p1_180; \
36558 float32x2_t __s2_180 = __p2_180; \
36559 float32x4_t __rev0_180; __rev0_180 = __builtin_shufflevector(__s0_180, __s0_180, 3, 2, 1, 0); \
36560 float32x4_t __rev1_180; __rev1_180 = __builtin_shufflevector(__s1_180, __s1_180, 3, 2, 1, 0); \
36561 float32x2_t __rev2_180; __rev2_180 = __builtin_shufflevector(__s2_180, __s2_180, 1, 0); \
36562float32x2_t __reint_180 = __rev2_180; \
36563uint64x2_t __reint1_180 = (uint64x2_t) {vget_lane_u64(*(uint64x1_t *) &__reint_180, __p3_180), vget_lane_u64(*(uint64x1_t *) &__reint_180, __p3_180)}; \
36564 __ret_180 = __noswap_vcmlaq_f32(__rev0_180, __rev1_180, *(float32x4_t *) &__reint1_180); \
36565 __ret_180 = __builtin_shufflevector(__ret_180, __ret_180, 3, 2, 1, 0); \
36566 __ret_180; \
36567})
3538436568#endif
3538536569
3538636570#ifdef __LITTLE_ENDIAN__
35387__ai float16x4_t vrnda_f16(float16x4_t __p0) {
35388 float16x4_t __ret;
35389 __ret = (float16x4_t) __builtin_neon_vrnda_v((int8x8_t)__p0, 8);
35390 return __ret;
35391}
36571#define vcmla_laneq_f32(__p0_181, __p1_181, __p2_181, __p3_181) __extension__ ({ \
36572 float32x2_t __ret_181; \
36573 float32x2_t __s0_181 = __p0_181; \
36574 float32x2_t __s1_181 = __p1_181; \
36575 float32x4_t __s2_181 = __p2_181; \
36576float32x4_t __reint_181 = __s2_181; \
36577uint64x1_t __reint1_181 = (uint64x1_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_181, __p3_181)}; \
36578 __ret_181 = vcmla_f32(__s0_181, __s1_181, *(float32x2_t *) &__reint1_181); \
36579 __ret_181; \
36580})
3539236581#else
35393__ai float16x4_t vrnda_f16(float16x4_t __p0) {
35394 float16x4_t __ret;
35395 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35396 __ret = (float16x4_t) __builtin_neon_vrnda_v((int8x8_t)__rev0, 8);
35397 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35398 return __ret;
35399}
36582#define vcmla_laneq_f32(__p0_182, __p1_182, __p2_182, __p3_182) __extension__ ({ \
36583 float32x2_t __ret_182; \
36584 float32x2_t __s0_182 = __p0_182; \
36585 float32x2_t __s1_182 = __p1_182; \
36586 float32x4_t __s2_182 = __p2_182; \
36587 float32x2_t __rev0_182; __rev0_182 = __builtin_shufflevector(__s0_182, __s0_182, 1, 0); \
36588 float32x2_t __rev1_182; __rev1_182 = __builtin_shufflevector(__s1_182, __s1_182, 1, 0); \
36589 float32x4_t __rev2_182; __rev2_182 = __builtin_shufflevector(__s2_182, __s2_182, 3, 2, 1, 0); \
36590float32x4_t __reint_182 = __rev2_182; \
36591uint64x1_t __reint1_182 = (uint64x1_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_182, __p3_182)}; \
36592 __ret_182 = __noswap_vcmla_f32(__rev0_182, __rev1_182, *(float32x2_t *) &__reint1_182); \
36593 __ret_182 = __builtin_shufflevector(__ret_182, __ret_182, 1, 0); \
36594 __ret_182; \
36595})
3540036596#endif
3540136597
3540236598#ifdef __LITTLE_ENDIAN__
35403__ai float16x8_t vrndmq_f16(float16x8_t __p0) {
35404 float16x8_t __ret;
35405 __ret = (float16x8_t) __builtin_neon_vrndmq_v((int8x16_t)__p0, 40);
35406 return __ret;
35407}
36599#define vcmlaq_laneq_f32(__p0_183, __p1_183, __p2_183, __p3_183) __extension__ ({ \
36600 float32x4_t __ret_183; \
36601 float32x4_t __s0_183 = __p0_183; \
36602 float32x4_t __s1_183 = __p1_183; \
36603 float32x4_t __s2_183 = __p2_183; \
36604float32x4_t __reint_183 = __s2_183; \
36605uint64x2_t __reint1_183 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_183, __p3_183), vgetq_lane_u64(*(uint64x2_t *) &__reint_183, __p3_183)}; \
36606 __ret_183 = vcmlaq_f32(__s0_183, __s1_183, *(float32x4_t *) &__reint1_183); \
36607 __ret_183; \
36608})
3540836609#else
35409__ai float16x8_t vrndmq_f16(float16x8_t __p0) {
35410 float16x8_t __ret;
35411 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35412 __ret = (float16x8_t) __builtin_neon_vrndmq_v((int8x16_t)__rev0, 40);
35413 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
35414 return __ret;
35415}
36610#define vcmlaq_laneq_f32(__p0_184, __p1_184, __p2_184, __p3_184) __extension__ ({ \
36611 float32x4_t __ret_184; \
36612 float32x4_t __s0_184 = __p0_184; \
36613 float32x4_t __s1_184 = __p1_184; \
36614 float32x4_t __s2_184 = __p2_184; \
36615 float32x4_t __rev0_184; __rev0_184 = __builtin_shufflevector(__s0_184, __s0_184, 3, 2, 1, 0); \
36616 float32x4_t __rev1_184; __rev1_184 = __builtin_shufflevector(__s1_184, __s1_184, 3, 2, 1, 0); \
36617 float32x4_t __rev2_184; __rev2_184 = __builtin_shufflevector(__s2_184, __s2_184, 3, 2, 1, 0); \
36618float32x4_t __reint_184 = __rev2_184; \
36619uint64x2_t __reint1_184 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_184, __p3_184), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_184, __p3_184)}; \
36620 __ret_184 = __noswap_vcmlaq_f32(__rev0_184, __rev1_184, *(float32x4_t *) &__reint1_184); \
36621 __ret_184 = __builtin_shufflevector(__ret_184, __ret_184, 3, 2, 1, 0); \
36622 __ret_184; \
36623})
3541636624#endif
3541736625
3541836626#ifdef __LITTLE_ENDIAN__
35419__ai float16x4_t vrndm_f16(float16x4_t __p0) {
35420 float16x4_t __ret;
35421 __ret = (float16x4_t) __builtin_neon_vrndm_v((int8x8_t)__p0, 8);
36627__ai __attribute__((target("v8.3a"))) float32x4_t vcmlaq_rot180_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
36628 float32x4_t __ret;
36629 __ret = (float32x4_t) __builtin_neon_vcmlaq_rot180_f32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
3542236630 return __ret;
3542336631}
3542436632#else
35425__ai float16x4_t vrndm_f16(float16x4_t __p0) {
35426 float16x4_t __ret;
35427 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35428 __ret = (float16x4_t) __builtin_neon_vrndm_v((int8x8_t)__rev0, 8);
36633__ai __attribute__((target("v8.3a"))) float32x4_t vcmlaq_rot180_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
36634 float32x4_t __ret;
36635 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
36636 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
36637 float32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
36638 __ret = (float32x4_t) __builtin_neon_vcmlaq_rot180_f32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 41);
3542936639 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3543036640 return __ret;
3543136641}
35432#endif
35433
35434#ifdef __LITTLE_ENDIAN__
35435__ai float16x8_t vrndnq_f16(float16x8_t __p0) {
35436 float16x8_t __ret;
35437 __ret = (float16x8_t) __builtin_neon_vrndnq_v((int8x16_t)__p0, 40);
35438 return __ret;
35439}
35440#else
35441__ai float16x8_t vrndnq_f16(float16x8_t __p0) {
35442 float16x8_t __ret;
35443 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35444 __ret = (float16x8_t) __builtin_neon_vrndnq_v((int8x16_t)__rev0, 40);
35445 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
36642__ai __attribute__((target("v8.3a"))) float32x4_t __noswap_vcmlaq_rot180_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
36643 float32x4_t __ret;
36644 __ret = (float32x4_t) __builtin_neon_vcmlaq_rot180_f32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
3544636645 return __ret;
3544736646}
3544836647#endif
3544936648
3545036649#ifdef __LITTLE_ENDIAN__
35451__ai float16x4_t vrndn_f16(float16x4_t __p0) {
35452 float16x4_t __ret;
35453 __ret = (float16x4_t) __builtin_neon_vrndn_v((int8x8_t)__p0, 8);
36650__ai __attribute__((target("v8.3a"))) float32x2_t vcmla_rot180_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
36651 float32x2_t __ret;
36652 __ret = (float32x2_t) __builtin_neon_vcmla_rot180_f32((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
3545436653 return __ret;
3545536654}
3545636655#else
35457__ai float16x4_t vrndn_f16(float16x4_t __p0) {
35458 float16x4_t __ret;
35459 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35460 __ret = (float16x4_t) __builtin_neon_vrndn_v((int8x8_t)__rev0, 8);
35461 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
36656__ai __attribute__((target("v8.3a"))) float32x2_t vcmla_rot180_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
36657 float32x2_t __ret;
36658 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
36659 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
36660 float32x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
36661 __ret = (float32x2_t) __builtin_neon_vcmla_rot180_f32((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 9);
36662 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
36663 return __ret;
36664}
36665__ai __attribute__((target("v8.3a"))) float32x2_t __noswap_vcmla_rot180_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
36666 float32x2_t __ret;
36667 __ret = (float32x2_t) __builtin_neon_vcmla_rot180_f32((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
3546236668 return __ret;
3546336669}
3546436670#endif
3546536671
3546636672#ifdef __LITTLE_ENDIAN__
35467__ai float16x8_t vrndpq_f16(float16x8_t __p0) {
35468 float16x8_t __ret;
35469 __ret = (float16x8_t) __builtin_neon_vrndpq_v((int8x16_t)__p0, 40);
35470 return __ret;
35471}
36673#define vcmla_rot180_lane_f32(__p0_185, __p1_185, __p2_185, __p3_185) __extension__ ({ \
36674 float32x2_t __ret_185; \
36675 float32x2_t __s0_185 = __p0_185; \
36676 float32x2_t __s1_185 = __p1_185; \
36677 float32x2_t __s2_185 = __p2_185; \
36678float32x2_t __reint_185 = __s2_185; \
36679uint64x1_t __reint1_185 = (uint64x1_t) {vget_lane_u64(*(uint64x1_t *) &__reint_185, __p3_185)}; \
36680 __ret_185 = vcmla_rot180_f32(__s0_185, __s1_185, *(float32x2_t *) &__reint1_185); \
36681 __ret_185; \
36682})
3547236683#else
35473__ai float16x8_t vrndpq_f16(float16x8_t __p0) {
35474 float16x8_t __ret;
35475 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35476 __ret = (float16x8_t) __builtin_neon_vrndpq_v((int8x16_t)__rev0, 40);
35477 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
35478 return __ret;
35479}
36684#define vcmla_rot180_lane_f32(__p0_186, __p1_186, __p2_186, __p3_186) __extension__ ({ \
36685 float32x2_t __ret_186; \
36686 float32x2_t __s0_186 = __p0_186; \
36687 float32x2_t __s1_186 = __p1_186; \
36688 float32x2_t __s2_186 = __p2_186; \
36689 float32x2_t __rev0_186; __rev0_186 = __builtin_shufflevector(__s0_186, __s0_186, 1, 0); \
36690 float32x2_t __rev1_186; __rev1_186 = __builtin_shufflevector(__s1_186, __s1_186, 1, 0); \
36691 float32x2_t __rev2_186; __rev2_186 = __builtin_shufflevector(__s2_186, __s2_186, 1, 0); \
36692float32x2_t __reint_186 = __rev2_186; \
36693uint64x1_t __reint1_186 = (uint64x1_t) {vget_lane_u64(*(uint64x1_t *) &__reint_186, __p3_186)}; \
36694 __ret_186 = __noswap_vcmla_rot180_f32(__rev0_186, __rev1_186, *(float32x2_t *) &__reint1_186); \
36695 __ret_186 = __builtin_shufflevector(__ret_186, __ret_186, 1, 0); \
36696 __ret_186; \
36697})
3548036698#endif
3548136699
3548236700#ifdef __LITTLE_ENDIAN__
35483__ai float16x4_t vrndp_f16(float16x4_t __p0) {
35484 float16x4_t __ret;
35485 __ret = (float16x4_t) __builtin_neon_vrndp_v((int8x8_t)__p0, 8);
35486 return __ret;
35487}
36701#define vcmlaq_rot180_lane_f32(__p0_187, __p1_187, __p2_187, __p3_187) __extension__ ({ \
36702 float32x4_t __ret_187; \
36703 float32x4_t __s0_187 = __p0_187; \
36704 float32x4_t __s1_187 = __p1_187; \
36705 float32x2_t __s2_187 = __p2_187; \
36706float32x2_t __reint_187 = __s2_187; \
36707uint64x2_t __reint1_187 = (uint64x2_t) {vget_lane_u64(*(uint64x1_t *) &__reint_187, __p3_187), vget_lane_u64(*(uint64x1_t *) &__reint_187, __p3_187)}; \
36708 __ret_187 = vcmlaq_rot180_f32(__s0_187, __s1_187, *(float32x4_t *) &__reint1_187); \
36709 __ret_187; \
36710})
3548836711#else
35489__ai float16x4_t vrndp_f16(float16x4_t __p0) {
35490 float16x4_t __ret;
35491 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35492 __ret = (float16x4_t) __builtin_neon_vrndp_v((int8x8_t)__rev0, 8);
35493 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35494 return __ret;
35495}
36712#define vcmlaq_rot180_lane_f32(__p0_188, __p1_188, __p2_188, __p3_188) __extension__ ({ \
36713 float32x4_t __ret_188; \
36714 float32x4_t __s0_188 = __p0_188; \
36715 float32x4_t __s1_188 = __p1_188; \
36716 float32x2_t __s2_188 = __p2_188; \
36717 float32x4_t __rev0_188; __rev0_188 = __builtin_shufflevector(__s0_188, __s0_188, 3, 2, 1, 0); \
36718 float32x4_t __rev1_188; __rev1_188 = __builtin_shufflevector(__s1_188, __s1_188, 3, 2, 1, 0); \
36719 float32x2_t __rev2_188; __rev2_188 = __builtin_shufflevector(__s2_188, __s2_188, 1, 0); \
36720float32x2_t __reint_188 = __rev2_188; \
36721uint64x2_t __reint1_188 = (uint64x2_t) {vget_lane_u64(*(uint64x1_t *) &__reint_188, __p3_188), vget_lane_u64(*(uint64x1_t *) &__reint_188, __p3_188)}; \
36722 __ret_188 = __noswap_vcmlaq_rot180_f32(__rev0_188, __rev1_188, *(float32x4_t *) &__reint1_188); \
36723 __ret_188 = __builtin_shufflevector(__ret_188, __ret_188, 3, 2, 1, 0); \
36724 __ret_188; \
36725})
3549636726#endif
3549736727
3549836728#ifdef __LITTLE_ENDIAN__
35499__ai float16x8_t vrndxq_f16(float16x8_t __p0) {
35500 float16x8_t __ret;
35501 __ret = (float16x8_t) __builtin_neon_vrndxq_v((int8x16_t)__p0, 40);
35502 return __ret;
35503}
36729#define vcmla_rot180_laneq_f32(__p0_189, __p1_189, __p2_189, __p3_189) __extension__ ({ \
36730 float32x2_t __ret_189; \
36731 float32x2_t __s0_189 = __p0_189; \
36732 float32x2_t __s1_189 = __p1_189; \
36733 float32x4_t __s2_189 = __p2_189; \
36734float32x4_t __reint_189 = __s2_189; \
36735uint64x1_t __reint1_189 = (uint64x1_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_189, __p3_189)}; \
36736 __ret_189 = vcmla_rot180_f32(__s0_189, __s1_189, *(float32x2_t *) &__reint1_189); \
36737 __ret_189; \
36738})
3550436739#else
35505__ai float16x8_t vrndxq_f16(float16x8_t __p0) {
35506 float16x8_t __ret;
35507 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35508 __ret = (float16x8_t) __builtin_neon_vrndxq_v((int8x16_t)__rev0, 40);
35509 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
35510 return __ret;
35511}
36740#define vcmla_rot180_laneq_f32(__p0_190, __p1_190, __p2_190, __p3_190) __extension__ ({ \
36741 float32x2_t __ret_190; \
36742 float32x2_t __s0_190 = __p0_190; \
36743 float32x2_t __s1_190 = __p1_190; \
36744 float32x4_t __s2_190 = __p2_190; \
36745 float32x2_t __rev0_190; __rev0_190 = __builtin_shufflevector(__s0_190, __s0_190, 1, 0); \
36746 float32x2_t __rev1_190; __rev1_190 = __builtin_shufflevector(__s1_190, __s1_190, 1, 0); \
36747 float32x4_t __rev2_190; __rev2_190 = __builtin_shufflevector(__s2_190, __s2_190, 3, 2, 1, 0); \
36748float32x4_t __reint_190 = __rev2_190; \
36749uint64x1_t __reint1_190 = (uint64x1_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_190, __p3_190)}; \
36750 __ret_190 = __noswap_vcmla_rot180_f32(__rev0_190, __rev1_190, *(float32x2_t *) &__reint1_190); \
36751 __ret_190 = __builtin_shufflevector(__ret_190, __ret_190, 1, 0); \
36752 __ret_190; \
36753})
3551236754#endif
3551336755
3551436756#ifdef __LITTLE_ENDIAN__
35515__ai float16x4_t vrndx_f16(float16x4_t __p0) {
35516 float16x4_t __ret;
35517 __ret = (float16x4_t) __builtin_neon_vrndx_v((int8x8_t)__p0, 8);
35518 return __ret;
35519}
36757#define vcmlaq_rot180_laneq_f32(__p0_191, __p1_191, __p2_191, __p3_191) __extension__ ({ \
36758 float32x4_t __ret_191; \
36759 float32x4_t __s0_191 = __p0_191; \
36760 float32x4_t __s1_191 = __p1_191; \
36761 float32x4_t __s2_191 = __p2_191; \
36762float32x4_t __reint_191 = __s2_191; \
36763uint64x2_t __reint1_191 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_191, __p3_191), vgetq_lane_u64(*(uint64x2_t *) &__reint_191, __p3_191)}; \
36764 __ret_191 = vcmlaq_rot180_f32(__s0_191, __s1_191, *(float32x4_t *) &__reint1_191); \
36765 __ret_191; \
36766})
3552036767#else
35521__ai float16x4_t vrndx_f16(float16x4_t __p0) {
35522 float16x4_t __ret;
35523 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35524 __ret = (float16x4_t) __builtin_neon_vrndx_v((int8x8_t)__rev0, 8);
35525 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35526 return __ret;
35527}
36768#define vcmlaq_rot180_laneq_f32(__p0_192, __p1_192, __p2_192, __p3_192) __extension__ ({ \
36769 float32x4_t __ret_192; \
36770 float32x4_t __s0_192 = __p0_192; \
36771 float32x4_t __s1_192 = __p1_192; \
36772 float32x4_t __s2_192 = __p2_192; \
36773 float32x4_t __rev0_192; __rev0_192 = __builtin_shufflevector(__s0_192, __s0_192, 3, 2, 1, 0); \
36774 float32x4_t __rev1_192; __rev1_192 = __builtin_shufflevector(__s1_192, __s1_192, 3, 2, 1, 0); \
36775 float32x4_t __rev2_192; __rev2_192 = __builtin_shufflevector(__s2_192, __s2_192, 3, 2, 1, 0); \
36776float32x4_t __reint_192 = __rev2_192; \
36777uint64x2_t __reint1_192 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_192, __p3_192), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_192, __p3_192)}; \
36778 __ret_192 = __noswap_vcmlaq_rot180_f32(__rev0_192, __rev1_192, *(float32x4_t *) &__reint1_192); \
36779 __ret_192 = __builtin_shufflevector(__ret_192, __ret_192, 3, 2, 1, 0); \
36780 __ret_192; \
36781})
3552836782#endif
3552936783
35530#endif
35531#if __ARM_ARCH >= 8 && defined(__ARM_FEATURE_NUMERIC_MAXMIN)
3553236784#ifdef __LITTLE_ENDIAN__
35533__ai float32x4_t vmaxnmq_f32(float32x4_t __p0, float32x4_t __p1) {
36785__ai __attribute__((target("v8.3a"))) float32x4_t vcmlaq_rot270_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
3553436786 float32x4_t __ret;
35535 __ret = (float32x4_t) __builtin_neon_vmaxnmq_v((int8x16_t)__p0, (int8x16_t)__p1, 41);
36787 __ret = (float32x4_t) __builtin_neon_vcmlaq_rot270_f32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
3553636788 return __ret;
3553736789}
3553836790#else
35539__ai float32x4_t vmaxnmq_f32(float32x4_t __p0, float32x4_t __p1) {
36791__ai __attribute__((target("v8.3a"))) float32x4_t vcmlaq_rot270_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
3554036792 float32x4_t __ret;
3554136793 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
3554236794 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
35543 __ret = (float32x4_t) __builtin_neon_vmaxnmq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 41);
36795 float32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
36796 __ret = (float32x4_t) __builtin_neon_vcmlaq_rot270_f32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 41);
3554436797 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3554536798 return __ret;
3554636799}
36800__ai __attribute__((target("v8.3a"))) float32x4_t __noswap_vcmlaq_rot270_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
36801 float32x4_t __ret;
36802 __ret = (float32x4_t) __builtin_neon_vcmlaq_rot270_f32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
36803 return __ret;
36804}
3554736805#endif
3554836806
3554936807#ifdef __LITTLE_ENDIAN__
35550__ai float32x2_t vmaxnm_f32(float32x2_t __p0, float32x2_t __p1) {
36808__ai __attribute__((target("v8.3a"))) float32x2_t vcmla_rot270_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
3555136809 float32x2_t __ret;
35552 __ret = (float32x2_t) __builtin_neon_vmaxnm_v((int8x8_t)__p0, (int8x8_t)__p1, 9);
36810 __ret = (float32x2_t) __builtin_neon_vcmla_rot270_f32((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
3555336811 return __ret;
3555436812}
3555536813#else
35556__ai float32x2_t vmaxnm_f32(float32x2_t __p0, float32x2_t __p1) {
36814__ai __attribute__((target("v8.3a"))) float32x2_t vcmla_rot270_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
3555736815 float32x2_t __ret;
3555836816 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
3555936817 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
35560 __ret = (float32x2_t) __builtin_neon_vmaxnm_v((int8x8_t)__rev0, (int8x8_t)__rev1, 9);
36818 float32x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
36819 __ret = (float32x2_t) __builtin_neon_vcmla_rot270_f32((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 9);
3556136820 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
3556236821 return __ret;
3556336822}
35564#endif
35565
35566#ifdef __LITTLE_ENDIAN__
35567__ai float32x4_t vminnmq_f32(float32x4_t __p0, float32x4_t __p1) {
35568 float32x4_t __ret;
35569 __ret = (float32x4_t) __builtin_neon_vminnmq_v((int8x16_t)__p0, (int8x16_t)__p1, 41);
35570 return __ret;
35571}
35572#else
35573__ai float32x4_t vminnmq_f32(float32x4_t __p0, float32x4_t __p1) {
35574 float32x4_t __ret;
35575 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35576 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
35577 __ret = (float32x4_t) __builtin_neon_vminnmq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 41);
35578 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
36823__ai __attribute__((target("v8.3a"))) float32x2_t __noswap_vcmla_rot270_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
36824 float32x2_t __ret;
36825 __ret = (float32x2_t) __builtin_neon_vcmla_rot270_f32((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
3557936826 return __ret;
3558036827}
3558136828#endif
3558236829
3558336830#ifdef __LITTLE_ENDIAN__
35584__ai float32x2_t vminnm_f32(float32x2_t __p0, float32x2_t __p1) {
35585 float32x2_t __ret;
35586 __ret = (float32x2_t) __builtin_neon_vminnm_v((int8x8_t)__p0, (int8x8_t)__p1, 9);
35587 return __ret;
35588}
36831#define vcmla_rot270_lane_f32(__p0_193, __p1_193, __p2_193, __p3_193) __extension__ ({ \
36832 float32x2_t __ret_193; \
36833 float32x2_t __s0_193 = __p0_193; \
36834 float32x2_t __s1_193 = __p1_193; \
36835 float32x2_t __s2_193 = __p2_193; \
36836float32x2_t __reint_193 = __s2_193; \
36837uint64x1_t __reint1_193 = (uint64x1_t) {vget_lane_u64(*(uint64x1_t *) &__reint_193, __p3_193)}; \
36838 __ret_193 = vcmla_rot270_f32(__s0_193, __s1_193, *(float32x2_t *) &__reint1_193); \
36839 __ret_193; \
36840})
3558936841#else
35590__ai float32x2_t vminnm_f32(float32x2_t __p0, float32x2_t __p1) {
35591 float32x2_t __ret;
35592 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
35593 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
35594 __ret = (float32x2_t) __builtin_neon_vminnm_v((int8x8_t)__rev0, (int8x8_t)__rev1, 9);
35595 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
35596 return __ret;
35597}
36842#define vcmla_rot270_lane_f32(__p0_194, __p1_194, __p2_194, __p3_194) __extension__ ({ \
36843 float32x2_t __ret_194; \
36844 float32x2_t __s0_194 = __p0_194; \
36845 float32x2_t __s1_194 = __p1_194; \
36846 float32x2_t __s2_194 = __p2_194; \
36847 float32x2_t __rev0_194; __rev0_194 = __builtin_shufflevector(__s0_194, __s0_194, 1, 0); \
36848 float32x2_t __rev1_194; __rev1_194 = __builtin_shufflevector(__s1_194, __s1_194, 1, 0); \
36849 float32x2_t __rev2_194; __rev2_194 = __builtin_shufflevector(__s2_194, __s2_194, 1, 0); \
36850float32x2_t __reint_194 = __rev2_194; \
36851uint64x1_t __reint1_194 = (uint64x1_t) {vget_lane_u64(*(uint64x1_t *) &__reint_194, __p3_194)}; \
36852 __ret_194 = __noswap_vcmla_rot270_f32(__rev0_194, __rev1_194, *(float32x2_t *) &__reint1_194); \
36853 __ret_194 = __builtin_shufflevector(__ret_194, __ret_194, 1, 0); \
36854 __ret_194; \
36855})
3559836856#endif
3559936857
35600#endif
35601#if __ARM_ARCH >= 8 && defined(__ARM_FEATURE_NUMERIC_MAXMIN) && defined(__ARM_FEATURE_FP16_VECTOR_ARITHMETIC)
3560236858#ifdef __LITTLE_ENDIAN__
35603__ai float16x8_t vmaxnmq_f16(float16x8_t __p0, float16x8_t __p1) {
35604 float16x8_t __ret;
35605 __ret = (float16x8_t) __builtin_neon_vmaxnmq_v((int8x16_t)__p0, (int8x16_t)__p1, 40);
35606 return __ret;
35607}
36859#define vcmlaq_rot270_lane_f32(__p0_195, __p1_195, __p2_195, __p3_195) __extension__ ({ \
36860 float32x4_t __ret_195; \
36861 float32x4_t __s0_195 = __p0_195; \
36862 float32x4_t __s1_195 = __p1_195; \
36863 float32x2_t __s2_195 = __p2_195; \
36864float32x2_t __reint_195 = __s2_195; \
36865uint64x2_t __reint1_195 = (uint64x2_t) {vget_lane_u64(*(uint64x1_t *) &__reint_195, __p3_195), vget_lane_u64(*(uint64x1_t *) &__reint_195, __p3_195)}; \
36866 __ret_195 = vcmlaq_rot270_f32(__s0_195, __s1_195, *(float32x4_t *) &__reint1_195); \
36867 __ret_195; \
36868})
3560836869#else
35609__ai float16x8_t vmaxnmq_f16(float16x8_t __p0, float16x8_t __p1) {
35610 float16x8_t __ret;
35611 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35612 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
35613 __ret = (float16x8_t) __builtin_neon_vmaxnmq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
35614 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
35615 return __ret;
35616}
36870#define vcmlaq_rot270_lane_f32(__p0_196, __p1_196, __p2_196, __p3_196) __extension__ ({ \
36871 float32x4_t __ret_196; \
36872 float32x4_t __s0_196 = __p0_196; \
36873 float32x4_t __s1_196 = __p1_196; \
36874 float32x2_t __s2_196 = __p2_196; \
36875 float32x4_t __rev0_196; __rev0_196 = __builtin_shufflevector(__s0_196, __s0_196, 3, 2, 1, 0); \
36876 float32x4_t __rev1_196; __rev1_196 = __builtin_shufflevector(__s1_196, __s1_196, 3, 2, 1, 0); \
36877 float32x2_t __rev2_196; __rev2_196 = __builtin_shufflevector(__s2_196, __s2_196, 1, 0); \
36878float32x2_t __reint_196 = __rev2_196; \
36879uint64x2_t __reint1_196 = (uint64x2_t) {vget_lane_u64(*(uint64x1_t *) &__reint_196, __p3_196), vget_lane_u64(*(uint64x1_t *) &__reint_196, __p3_196)}; \
36880 __ret_196 = __noswap_vcmlaq_rot270_f32(__rev0_196, __rev1_196, *(float32x4_t *) &__reint1_196); \
36881 __ret_196 = __builtin_shufflevector(__ret_196, __ret_196, 3, 2, 1, 0); \
36882 __ret_196; \
36883})
3561736884#endif
3561836885
3561936886#ifdef __LITTLE_ENDIAN__
35620__ai float16x4_t vmaxnm_f16(float16x4_t __p0, float16x4_t __p1) {
35621 float16x4_t __ret;
35622 __ret = (float16x4_t) __builtin_neon_vmaxnm_v((int8x8_t)__p0, (int8x8_t)__p1, 8);
35623 return __ret;
35624}
36887#define vcmla_rot270_laneq_f32(__p0_197, __p1_197, __p2_197, __p3_197) __extension__ ({ \
36888 float32x2_t __ret_197; \
36889 float32x2_t __s0_197 = __p0_197; \
36890 float32x2_t __s1_197 = __p1_197; \
36891 float32x4_t __s2_197 = __p2_197; \
36892float32x4_t __reint_197 = __s2_197; \
36893uint64x1_t __reint1_197 = (uint64x1_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_197, __p3_197)}; \
36894 __ret_197 = vcmla_rot270_f32(__s0_197, __s1_197, *(float32x2_t *) &__reint1_197); \
36895 __ret_197; \
36896})
3562536897#else
35626__ai float16x4_t vmaxnm_f16(float16x4_t __p0, float16x4_t __p1) {
35627 float16x4_t __ret;
35628 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35629 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
35630 __ret = (float16x4_t) __builtin_neon_vmaxnm_v((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
35631 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35632 return __ret;
35633}
36898#define vcmla_rot270_laneq_f32(__p0_198, __p1_198, __p2_198, __p3_198) __extension__ ({ \
36899 float32x2_t __ret_198; \
36900 float32x2_t __s0_198 = __p0_198; \
36901 float32x2_t __s1_198 = __p1_198; \
36902 float32x4_t __s2_198 = __p2_198; \
36903 float32x2_t __rev0_198; __rev0_198 = __builtin_shufflevector(__s0_198, __s0_198, 1, 0); \
36904 float32x2_t __rev1_198; __rev1_198 = __builtin_shufflevector(__s1_198, __s1_198, 1, 0); \
36905 float32x4_t __rev2_198; __rev2_198 = __builtin_shufflevector(__s2_198, __s2_198, 3, 2, 1, 0); \
36906float32x4_t __reint_198 = __rev2_198; \
36907uint64x1_t __reint1_198 = (uint64x1_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_198, __p3_198)}; \
36908 __ret_198 = __noswap_vcmla_rot270_f32(__rev0_198, __rev1_198, *(float32x2_t *) &__reint1_198); \
36909 __ret_198 = __builtin_shufflevector(__ret_198, __ret_198, 1, 0); \
36910 __ret_198; \
36911})
3563436912#endif
3563536913
3563636914#ifdef __LITTLE_ENDIAN__
35637__ai float16x8_t vminnmq_f16(float16x8_t __p0, float16x8_t __p1) {
35638 float16x8_t __ret;
35639 __ret = (float16x8_t) __builtin_neon_vminnmq_v((int8x16_t)__p0, (int8x16_t)__p1, 40);
35640 return __ret;
35641}
36915#define vcmlaq_rot270_laneq_f32(__p0_199, __p1_199, __p2_199, __p3_199) __extension__ ({ \
36916 float32x4_t __ret_199; \
36917 float32x4_t __s0_199 = __p0_199; \
36918 float32x4_t __s1_199 = __p1_199; \
36919 float32x4_t __s2_199 = __p2_199; \
36920float32x4_t __reint_199 = __s2_199; \
36921uint64x2_t __reint1_199 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_199, __p3_199), vgetq_lane_u64(*(uint64x2_t *) &__reint_199, __p3_199)}; \
36922 __ret_199 = vcmlaq_rot270_f32(__s0_199, __s1_199, *(float32x4_t *) &__reint1_199); \
36923 __ret_199; \
36924})
3564236925#else
35643__ai float16x8_t vminnmq_f16(float16x8_t __p0, float16x8_t __p1) {
35644 float16x8_t __ret;
35645 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35646 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
35647 __ret = (float16x8_t) __builtin_neon_vminnmq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
35648 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
35649 return __ret;
35650}
36926#define vcmlaq_rot270_laneq_f32(__p0_200, __p1_200, __p2_200, __p3_200) __extension__ ({ \
36927 float32x4_t __ret_200; \
36928 float32x4_t __s0_200 = __p0_200; \
36929 float32x4_t __s1_200 = __p1_200; \
36930 float32x4_t __s2_200 = __p2_200; \
36931 float32x4_t __rev0_200; __rev0_200 = __builtin_shufflevector(__s0_200, __s0_200, 3, 2, 1, 0); \
36932 float32x4_t __rev1_200; __rev1_200 = __builtin_shufflevector(__s1_200, __s1_200, 3, 2, 1, 0); \
36933 float32x4_t __rev2_200; __rev2_200 = __builtin_shufflevector(__s2_200, __s2_200, 3, 2, 1, 0); \
36934float32x4_t __reint_200 = __rev2_200; \
36935uint64x2_t __reint1_200 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_200, __p3_200), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_200, __p3_200)}; \
36936 __ret_200 = __noswap_vcmlaq_rot270_f32(__rev0_200, __rev1_200, *(float32x4_t *) &__reint1_200); \
36937 __ret_200 = __builtin_shufflevector(__ret_200, __ret_200, 3, 2, 1, 0); \
36938 __ret_200; \
36939})
3565136940#endif
3565236941
3565336942#ifdef __LITTLE_ENDIAN__
35654__ai float16x4_t vminnm_f16(float16x4_t __p0, float16x4_t __p1) {
35655 float16x4_t __ret;
35656 __ret = (float16x4_t) __builtin_neon_vminnm_v((int8x8_t)__p0, (int8x8_t)__p1, 8);
36943__ai __attribute__((target("v8.3a"))) float32x4_t vcmlaq_rot90_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
36944 float32x4_t __ret;
36945 __ret = (float32x4_t) __builtin_neon_vcmlaq_rot90_f32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
3565736946 return __ret;
3565836947}
3565936948#else
35660__ai float16x4_t vminnm_f16(float16x4_t __p0, float16x4_t __p1) {
35661 float16x4_t __ret;
35662 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35663 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
35664 __ret = (float16x4_t) __builtin_neon_vminnm_v((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
36949__ai __attribute__((target("v8.3a"))) float32x4_t vcmlaq_rot90_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
36950 float32x4_t __ret;
36951 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
36952 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
36953 float32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
36954 __ret = (float32x4_t) __builtin_neon_vcmlaq_rot90_f32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 41);
3566536955 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3566636956 return __ret;
3566736957}
36958__ai __attribute__((target("v8.3a"))) float32x4_t __noswap_vcmlaq_rot90_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
36959 float32x4_t __ret;
36960 __ret = (float32x4_t) __builtin_neon_vcmlaq_rot90_f32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
36961 return __ret;
36962}
3566836963#endif
3566936964
35670#endif
35671#if __ARM_ARCH >= 8 && defined(__ARM_FEATURE_SHA2)
3567236965#ifdef __LITTLE_ENDIAN__
35673__ai uint32x4_t vsha1cq_u32(uint32x4_t __p0, uint32_t __p1, uint32x4_t __p2) {
35674 uint32x4_t __ret;
35675 __ret = (uint32x4_t) __builtin_neon_vsha1cq_u32(__p0, __p1, __p2);
36966__ai __attribute__((target("v8.3a"))) float32x2_t vcmla_rot90_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
36967 float32x2_t __ret;
36968 __ret = (float32x2_t) __builtin_neon_vcmla_rot90_f32((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
3567636969 return __ret;
3567736970}
3567836971#else
35679__ai uint32x4_t vsha1cq_u32(uint32x4_t __p0, uint32_t __p1, uint32x4_t __p2) {
35680 uint32x4_t __ret;
35681 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35682 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
35683 __ret = (uint32x4_t) __builtin_neon_vsha1cq_u32(__rev0, __p1, __rev2);
35684 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
36972__ai __attribute__((target("v8.3a"))) float32x2_t vcmla_rot90_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
36973 float32x2_t __ret;
36974 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
36975 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
36976 float32x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
36977 __ret = (float32x2_t) __builtin_neon_vcmla_rot90_f32((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 9);
36978 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
3568536979 return __ret;
3568636980}
35687#endif
35688
35689__ai uint32_t vsha1h_u32(uint32_t __p0) {
35690 uint32_t __ret;
35691 __ret = (uint32_t) __builtin_neon_vsha1h_u32(__p0);
36981__ai __attribute__((target("v8.3a"))) float32x2_t __noswap_vcmla_rot90_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
36982 float32x2_t __ret;
36983 __ret = (float32x2_t) __builtin_neon_vcmla_rot90_f32((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
3569236984 return __ret;
3569336985}
36986#endif
36987
3569436988#ifdef __LITTLE_ENDIAN__
35695__ai uint32x4_t vsha1mq_u32(uint32x4_t __p0, uint32_t __p1, uint32x4_t __p2) {
35696 uint32x4_t __ret;
35697 __ret = (uint32x4_t) __builtin_neon_vsha1mq_u32(__p0, __p1, __p2);
35698 return __ret;
35699}
36989#define vcmla_rot90_lane_f32(__p0_201, __p1_201, __p2_201, __p3_201) __extension__ ({ \
36990 float32x2_t __ret_201; \
36991 float32x2_t __s0_201 = __p0_201; \
36992 float32x2_t __s1_201 = __p1_201; \
36993 float32x2_t __s2_201 = __p2_201; \
36994float32x2_t __reint_201 = __s2_201; \
36995uint64x1_t __reint1_201 = (uint64x1_t) {vget_lane_u64(*(uint64x1_t *) &__reint_201, __p3_201)}; \
36996 __ret_201 = vcmla_rot90_f32(__s0_201, __s1_201, *(float32x2_t *) &__reint1_201); \
36997 __ret_201; \
36998})
3570036999#else
35701__ai uint32x4_t vsha1mq_u32(uint32x4_t __p0, uint32_t __p1, uint32x4_t __p2) {
35702 uint32x4_t __ret;
35703 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35704 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
35705 __ret = (uint32x4_t) __builtin_neon_vsha1mq_u32(__rev0, __p1, __rev2);
35706 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35707 return __ret;
35708}
37000#define vcmla_rot90_lane_f32(__p0_202, __p1_202, __p2_202, __p3_202) __extension__ ({ \
37001 float32x2_t __ret_202; \
37002 float32x2_t __s0_202 = __p0_202; \
37003 float32x2_t __s1_202 = __p1_202; \
37004 float32x2_t __s2_202 = __p2_202; \
37005 float32x2_t __rev0_202; __rev0_202 = __builtin_shufflevector(__s0_202, __s0_202, 1, 0); \
37006 float32x2_t __rev1_202; __rev1_202 = __builtin_shufflevector(__s1_202, __s1_202, 1, 0); \
37007 float32x2_t __rev2_202; __rev2_202 = __builtin_shufflevector(__s2_202, __s2_202, 1, 0); \
37008float32x2_t __reint_202 = __rev2_202; \
37009uint64x1_t __reint1_202 = (uint64x1_t) {vget_lane_u64(*(uint64x1_t *) &__reint_202, __p3_202)}; \
37010 __ret_202 = __noswap_vcmla_rot90_f32(__rev0_202, __rev1_202, *(float32x2_t *) &__reint1_202); \
37011 __ret_202 = __builtin_shufflevector(__ret_202, __ret_202, 1, 0); \
37012 __ret_202; \
37013})
3570937014#endif
3571037015
3571137016#ifdef __LITTLE_ENDIAN__
35712__ai uint32x4_t vsha1pq_u32(uint32x4_t __p0, uint32_t __p1, uint32x4_t __p2) {
35713 uint32x4_t __ret;
35714 __ret = (uint32x4_t) __builtin_neon_vsha1pq_u32(__p0, __p1, __p2);
35715 return __ret;
35716}
37017#define vcmlaq_rot90_lane_f32(__p0_203, __p1_203, __p2_203, __p3_203) __extension__ ({ \
37018 float32x4_t __ret_203; \
37019 float32x4_t __s0_203 = __p0_203; \
37020 float32x4_t __s1_203 = __p1_203; \
37021 float32x2_t __s2_203 = __p2_203; \
37022float32x2_t __reint_203 = __s2_203; \
37023uint64x2_t __reint1_203 = (uint64x2_t) {vget_lane_u64(*(uint64x1_t *) &__reint_203, __p3_203), vget_lane_u64(*(uint64x1_t *) &__reint_203, __p3_203)}; \
37024 __ret_203 = vcmlaq_rot90_f32(__s0_203, __s1_203, *(float32x4_t *) &__reint1_203); \
37025 __ret_203; \
37026})
3571737027#else
35718__ai uint32x4_t vsha1pq_u32(uint32x4_t __p0, uint32_t __p1, uint32x4_t __p2) {
35719 uint32x4_t __ret;
35720 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35721 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
35722 __ret = (uint32x4_t) __builtin_neon_vsha1pq_u32(__rev0, __p1, __rev2);
35723 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35724 return __ret;
35725}
37028#define vcmlaq_rot90_lane_f32(__p0_204, __p1_204, __p2_204, __p3_204) __extension__ ({ \
37029 float32x4_t __ret_204; \
37030 float32x4_t __s0_204 = __p0_204; \
37031 float32x4_t __s1_204 = __p1_204; \
37032 float32x2_t __s2_204 = __p2_204; \
37033 float32x4_t __rev0_204; __rev0_204 = __builtin_shufflevector(__s0_204, __s0_204, 3, 2, 1, 0); \
37034 float32x4_t __rev1_204; __rev1_204 = __builtin_shufflevector(__s1_204, __s1_204, 3, 2, 1, 0); \
37035 float32x2_t __rev2_204; __rev2_204 = __builtin_shufflevector(__s2_204, __s2_204, 1, 0); \
37036float32x2_t __reint_204 = __rev2_204; \
37037uint64x2_t __reint1_204 = (uint64x2_t) {vget_lane_u64(*(uint64x1_t *) &__reint_204, __p3_204), vget_lane_u64(*(uint64x1_t *) &__reint_204, __p3_204)}; \
37038 __ret_204 = __noswap_vcmlaq_rot90_f32(__rev0_204, __rev1_204, *(float32x4_t *) &__reint1_204); \
37039 __ret_204 = __builtin_shufflevector(__ret_204, __ret_204, 3, 2, 1, 0); \
37040 __ret_204; \
37041})
3572637042#endif
3572737043
3572837044#ifdef __LITTLE_ENDIAN__
35729__ai uint32x4_t vsha1su0q_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
35730 uint32x4_t __ret;
35731 __ret = (uint32x4_t) __builtin_neon_vsha1su0q_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 50);
35732 return __ret;
35733}
37045#define vcmla_rot90_laneq_f32(__p0_205, __p1_205, __p2_205, __p3_205) __extension__ ({ \
37046 float32x2_t __ret_205; \
37047 float32x2_t __s0_205 = __p0_205; \
37048 float32x2_t __s1_205 = __p1_205; \
37049 float32x4_t __s2_205 = __p2_205; \
37050float32x4_t __reint_205 = __s2_205; \
37051uint64x1_t __reint1_205 = (uint64x1_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_205, __p3_205)}; \
37052 __ret_205 = vcmla_rot90_f32(__s0_205, __s1_205, *(float32x2_t *) &__reint1_205); \
37053 __ret_205; \
37054})
3573437055#else
35735__ai uint32x4_t vsha1su0q_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
35736 uint32x4_t __ret;
35737 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35738 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
35739 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
35740 __ret = (uint32x4_t) __builtin_neon_vsha1su0q_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 50);
35741 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35742 return __ret;
35743}
37056#define vcmla_rot90_laneq_f32(__p0_206, __p1_206, __p2_206, __p3_206) __extension__ ({ \
37057 float32x2_t __ret_206; \
37058 float32x2_t __s0_206 = __p0_206; \
37059 float32x2_t __s1_206 = __p1_206; \
37060 float32x4_t __s2_206 = __p2_206; \
37061 float32x2_t __rev0_206; __rev0_206 = __builtin_shufflevector(__s0_206, __s0_206, 1, 0); \
37062 float32x2_t __rev1_206; __rev1_206 = __builtin_shufflevector(__s1_206, __s1_206, 1, 0); \
37063 float32x4_t __rev2_206; __rev2_206 = __builtin_shufflevector(__s2_206, __s2_206, 3, 2, 1, 0); \
37064float32x4_t __reint_206 = __rev2_206; \
37065uint64x1_t __reint1_206 = (uint64x1_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_206, __p3_206)}; \
37066 __ret_206 = __noswap_vcmla_rot90_f32(__rev0_206, __rev1_206, *(float32x2_t *) &__reint1_206); \
37067 __ret_206 = __builtin_shufflevector(__ret_206, __ret_206, 1, 0); \
37068 __ret_206; \
37069})
3574437070#endif
3574537071
3574637072#ifdef __LITTLE_ENDIAN__
35747__ai uint32x4_t vsha1su1q_u32(uint32x4_t __p0, uint32x4_t __p1) {
35748 uint32x4_t __ret;
35749 __ret = (uint32x4_t) __builtin_neon_vsha1su1q_v((int8x16_t)__p0, (int8x16_t)__p1, 50);
35750 return __ret;
35751}
37073#define vcmlaq_rot90_laneq_f32(__p0_207, __p1_207, __p2_207, __p3_207) __extension__ ({ \
37074 float32x4_t __ret_207; \
37075 float32x4_t __s0_207 = __p0_207; \
37076 float32x4_t __s1_207 = __p1_207; \
37077 float32x4_t __s2_207 = __p2_207; \
37078float32x4_t __reint_207 = __s2_207; \
37079uint64x2_t __reint1_207 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_207, __p3_207), vgetq_lane_u64(*(uint64x2_t *) &__reint_207, __p3_207)}; \
37080 __ret_207 = vcmlaq_rot90_f32(__s0_207, __s1_207, *(float32x4_t *) &__reint1_207); \
37081 __ret_207; \
37082})
3575237083#else
35753__ai uint32x4_t vsha1su1q_u32(uint32x4_t __p0, uint32x4_t __p1) {
35754 uint32x4_t __ret;
35755 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35756 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
35757 __ret = (uint32x4_t) __builtin_neon_vsha1su1q_v((int8x16_t)__rev0, (int8x16_t)__rev1, 50);
35758 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35759 return __ret;
35760}
37084#define vcmlaq_rot90_laneq_f32(__p0_208, __p1_208, __p2_208, __p3_208) __extension__ ({ \
37085 float32x4_t __ret_208; \
37086 float32x4_t __s0_208 = __p0_208; \
37087 float32x4_t __s1_208 = __p1_208; \
37088 float32x4_t __s2_208 = __p2_208; \
37089 float32x4_t __rev0_208; __rev0_208 = __builtin_shufflevector(__s0_208, __s0_208, 3, 2, 1, 0); \
37090 float32x4_t __rev1_208; __rev1_208 = __builtin_shufflevector(__s1_208, __s1_208, 3, 2, 1, 0); \
37091 float32x4_t __rev2_208; __rev2_208 = __builtin_shufflevector(__s2_208, __s2_208, 3, 2, 1, 0); \
37092float32x4_t __reint_208 = __rev2_208; \
37093uint64x2_t __reint1_208 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_208, __p3_208), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_208, __p3_208)}; \
37094 __ret_208 = __noswap_vcmlaq_rot90_f32(__rev0_208, __rev1_208, *(float32x4_t *) &__reint1_208); \
37095 __ret_208 = __builtin_shufflevector(__ret_208, __ret_208, 3, 2, 1, 0); \
37096 __ret_208; \
37097})
3576137098#endif
3576237099
3576337100#ifdef __LITTLE_ENDIAN__
35764__ai uint32x4_t vsha256hq_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
35765 uint32x4_t __ret;
35766 __ret = (uint32x4_t) __builtin_neon_vsha256hq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 50);
37101__ai __attribute__((target("v8.3a,fullfp16"))) float16x4_t vcadd_rot270_f16(float16x4_t __p0, float16x4_t __p1) {
37102 float16x4_t __ret;
37103 __ret = (float16x4_t) __builtin_neon_vcadd_rot270_f16((int8x8_t)__p0, (int8x8_t)__p1, 8);
3576737104 return __ret;
3576837105}
3576937106#else
35770__ai uint32x4_t vsha256hq_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
35771 uint32x4_t __ret;
35772 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35773 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
35774 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
35775 __ret = (uint32x4_t) __builtin_neon_vsha256hq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 50);
37107__ai __attribute__((target("v8.3a,fullfp16"))) float16x4_t vcadd_rot270_f16(float16x4_t __p0, float16x4_t __p1) {
37108 float16x4_t __ret;
37109 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
37110 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
37111 __ret = (float16x4_t) __builtin_neon_vcadd_rot270_f16((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
3577637112 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3577737113 return __ret;
3577837114}
3577937115#endif
3578037116
3578137117#ifdef __LITTLE_ENDIAN__
35782__ai uint32x4_t vsha256h2q_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
35783 uint32x4_t __ret;
35784 __ret = (uint32x4_t) __builtin_neon_vsha256h2q_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 50);
37118__ai __attribute__((target("v8.3a,fullfp16"))) float16x4_t vcadd_rot90_f16(float16x4_t __p0, float16x4_t __p1) {
37119 float16x4_t __ret;
37120 __ret = (float16x4_t) __builtin_neon_vcadd_rot90_f16((int8x8_t)__p0, (int8x8_t)__p1, 8);
3578537121 return __ret;
3578637122}
3578737123#else
35788__ai uint32x4_t vsha256h2q_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
35789 uint32x4_t __ret;
35790 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35791 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
35792 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
35793 __ret = (uint32x4_t) __builtin_neon_vsha256h2q_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 50);
37124__ai __attribute__((target("v8.3a,fullfp16"))) float16x4_t vcadd_rot90_f16(float16x4_t __p0, float16x4_t __p1) {
37125 float16x4_t __ret;
37126 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
37127 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
37128 __ret = (float16x4_t) __builtin_neon_vcadd_rot90_f16((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
3579437129 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3579537130 return __ret;
3579637131}
3579737132#endif
3579837133
3579937134#ifdef __LITTLE_ENDIAN__
35800__ai uint32x4_t vsha256su0q_u32(uint32x4_t __p0, uint32x4_t __p1) {
35801 uint32x4_t __ret;
35802 __ret = (uint32x4_t) __builtin_neon_vsha256su0q_v((int8x16_t)__p0, (int8x16_t)__p1, 50);
37135__ai __attribute__((target("v8.3a,fullfp16"))) float16x8_t vcaddq_rot270_f16(float16x8_t __p0, float16x8_t __p1) {
37136 float16x8_t __ret;
37137 __ret = (float16x8_t) __builtin_neon_vcaddq_rot270_f16((int8x16_t)__p0, (int8x16_t)__p1, 40);
3580337138 return __ret;
3580437139}
3580537140#else
35806__ai uint32x4_t vsha256su0q_u32(uint32x4_t __p0, uint32x4_t __p1) {
35807 uint32x4_t __ret;
35808 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35809 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
35810 __ret = (uint32x4_t) __builtin_neon_vsha256su0q_v((int8x16_t)__rev0, (int8x16_t)__rev1, 50);
35811 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
37141__ai __attribute__((target("v8.3a,fullfp16"))) float16x8_t vcaddq_rot270_f16(float16x8_t __p0, float16x8_t __p1) {
37142 float16x8_t __ret;
37143 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
37144 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
37145 __ret = (float16x8_t) __builtin_neon_vcaddq_rot270_f16((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
37146 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
3581237147 return __ret;
3581337148}
3581437149#endif
3581537150
3581637151#ifdef __LITTLE_ENDIAN__
35817__ai uint32x4_t vsha256su1q_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
35818 uint32x4_t __ret;
35819 __ret = (uint32x4_t) __builtin_neon_vsha256su1q_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 50);
37152__ai __attribute__((target("v8.3a,fullfp16"))) float16x8_t vcaddq_rot90_f16(float16x8_t __p0, float16x8_t __p1) {
37153 float16x8_t __ret;
37154 __ret = (float16x8_t) __builtin_neon_vcaddq_rot90_f16((int8x16_t)__p0, (int8x16_t)__p1, 40);
3582037155 return __ret;
3582137156}
3582237157#else
35823__ai uint32x4_t vsha256su1q_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
35824 uint32x4_t __ret;
35825 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35826 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
35827 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
35828 __ret = (uint32x4_t) __builtin_neon_vsha256su1q_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 50);
35829 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
37158__ai __attribute__((target("v8.3a,fullfp16"))) float16x8_t vcaddq_rot90_f16(float16x8_t __p0, float16x8_t __p1) {
37159 float16x8_t __ret;
37160 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
37161 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
37162 __ret = (float16x8_t) __builtin_neon_vcaddq_rot90_f16((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
37163 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
3583037164 return __ret;
3583137165}
3583237166#endif
3583337167
35834#endif
35835#if __ARM_ARCH >= 8 && defined(__ARM_FEATURE_SHA3) && defined(__aarch64__)
3583637168#ifdef __LITTLE_ENDIAN__
35837__ai uint8x16_t vbcaxq_u8(uint8x16_t __p0, uint8x16_t __p1, uint8x16_t __p2) {
35838 uint8x16_t __ret;
35839 __ret = (uint8x16_t) __builtin_neon_vbcaxq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 48);
37169__ai __attribute__((target("v8.3a,fullfp16"))) float16x8_t vcmlaq_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
37170 float16x8_t __ret;
37171 __ret = (float16x8_t) __builtin_neon_vcmlaq_f16((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 40);
3584037172 return __ret;
3584137173}
3584237174#else
35843__ai uint8x16_t vbcaxq_u8(uint8x16_t __p0, uint8x16_t __p1, uint8x16_t __p2) {
35844 uint8x16_t __ret;
35845 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
35846 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
35847 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
35848 __ret = (uint8x16_t) __builtin_neon_vbcaxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 48);
35849 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
37175__ai __attribute__((target("v8.3a,fullfp16"))) float16x8_t vcmlaq_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
37176 float16x8_t __ret;
37177 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
37178 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
37179 float16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
37180 __ret = (float16x8_t) __builtin_neon_vcmlaq_f16((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 40);
37181 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
37182 return __ret;
37183}
37184__ai __attribute__((target("v8.3a,fullfp16"))) float16x8_t __noswap_vcmlaq_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
37185 float16x8_t __ret;
37186 __ret = (float16x8_t) __builtin_neon_vcmlaq_f16((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 40);
3585037187 return __ret;
3585137188}
3585237189#endif
3585337190
3585437191#ifdef __LITTLE_ENDIAN__
35855__ai uint32x4_t vbcaxq_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
35856 uint32x4_t __ret;
35857 __ret = (uint32x4_t) __builtin_neon_vbcaxq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 50);
37192__ai __attribute__((target("v8.3a,fullfp16"))) float16x4_t vcmla_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
37193 float16x4_t __ret;
37194 __ret = (float16x4_t) __builtin_neon_vcmla_f16((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 8);
3585837195 return __ret;
3585937196}
3586037197#else
35861__ai uint32x4_t vbcaxq_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
35862 uint32x4_t __ret;
35863 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35864 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
35865 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
35866 __ret = (uint32x4_t) __builtin_neon_vbcaxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 50);
37198__ai __attribute__((target("v8.3a,fullfp16"))) float16x4_t vcmla_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
37199 float16x4_t __ret;
37200 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
37201 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
37202 float16x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
37203 __ret = (float16x4_t) __builtin_neon_vcmla_f16((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 8);
3586737204 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3586837205 return __ret;
3586937206}
35870#endif
35871
35872#ifdef __LITTLE_ENDIAN__
35873__ai uint64x2_t vbcaxq_u64(uint64x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
35874 uint64x2_t __ret;
35875 __ret = (uint64x2_t) __builtin_neon_vbcaxq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 51);
35876 return __ret;
35877}
35878#else
35879__ai uint64x2_t vbcaxq_u64(uint64x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
35880 uint64x2_t __ret;
35881 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
35882 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
35883 uint64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
35884 __ret = (uint64x2_t) __builtin_neon_vbcaxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 51);
35885 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
37207__ai __attribute__((target("v8.3a,fullfp16"))) float16x4_t __noswap_vcmla_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
37208 float16x4_t __ret;
37209 __ret = (float16x4_t) __builtin_neon_vcmla_f16((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 8);
3588637210 return __ret;
3588737211}
3588837212#endif
3588937213
3589037214#ifdef __LITTLE_ENDIAN__
35891__ai uint16x8_t vbcaxq_u16(uint16x8_t __p0, uint16x8_t __p1, uint16x8_t __p2) {
35892 uint16x8_t __ret;
35893 __ret = (uint16x8_t) __builtin_neon_vbcaxq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 49);
35894 return __ret;
35895}
37215#define vcmla_lane_f16(__p0_209, __p1_209, __p2_209, __p3_209) __extension__ ({ \
37216 float16x4_t __ret_209; \
37217 float16x4_t __s0_209 = __p0_209; \
37218 float16x4_t __s1_209 = __p1_209; \
37219 float16x4_t __s2_209 = __p2_209; \
37220float16x4_t __reint_209 = __s2_209; \
37221uint32x2_t __reint1_209 = (uint32x2_t) {vget_lane_u32(*(uint32x2_t *) &__reint_209, __p3_209), vget_lane_u32(*(uint32x2_t *) &__reint_209, __p3_209)}; \
37222 __ret_209 = vcmla_f16(__s0_209, __s1_209, *(float16x4_t *) &__reint1_209); \
37223 __ret_209; \
37224})
3589637225#else
35897__ai uint16x8_t vbcaxq_u16(uint16x8_t __p0, uint16x8_t __p1, uint16x8_t __p2) {
35898 uint16x8_t __ret;
35899 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35900 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
35901 uint16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
35902 __ret = (uint16x8_t) __builtin_neon_vbcaxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 49);
35903 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
35904 return __ret;
35905}
37226#define vcmla_lane_f16(__p0_210, __p1_210, __p2_210, __p3_210) __extension__ ({ \
37227 float16x4_t __ret_210; \
37228 float16x4_t __s0_210 = __p0_210; \
37229 float16x4_t __s1_210 = __p1_210; \
37230 float16x4_t __s2_210 = __p2_210; \
37231 float16x4_t __rev0_210; __rev0_210 = __builtin_shufflevector(__s0_210, __s0_210, 3, 2, 1, 0); \
37232 float16x4_t __rev1_210; __rev1_210 = __builtin_shufflevector(__s1_210, __s1_210, 3, 2, 1, 0); \
37233 float16x4_t __rev2_210; __rev2_210 = __builtin_shufflevector(__s2_210, __s2_210, 3, 2, 1, 0); \
37234float16x4_t __reint_210 = __rev2_210; \
37235uint32x2_t __reint1_210 = (uint32x2_t) {__noswap_vget_lane_u32(*(uint32x2_t *) &__reint_210, __p3_210), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_210, __p3_210)}; \
37236 __ret_210 = __noswap_vcmla_f16(__rev0_210, __rev1_210, *(float16x4_t *) &__reint1_210); \
37237 __ret_210 = __builtin_shufflevector(__ret_210, __ret_210, 3, 2, 1, 0); \
37238 __ret_210; \
37239})
3590637240#endif
3590737241
3590837242#ifdef __LITTLE_ENDIAN__
35909__ai int8x16_t vbcaxq_s8(int8x16_t __p0, int8x16_t __p1, int8x16_t __p2) {
35910 int8x16_t __ret;
35911 __ret = (int8x16_t) __builtin_neon_vbcaxq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 32);
35912 return __ret;
35913}
37243#define vcmlaq_lane_f16(__p0_211, __p1_211, __p2_211, __p3_211) __extension__ ({ \
37244 float16x8_t __ret_211; \
37245 float16x8_t __s0_211 = __p0_211; \
37246 float16x8_t __s1_211 = __p1_211; \
37247 float16x4_t __s2_211 = __p2_211; \
37248float16x4_t __reint_211 = __s2_211; \
37249uint32x4_t __reint1_211 = (uint32x4_t) {vget_lane_u32(*(uint32x2_t *) &__reint_211, __p3_211), vget_lane_u32(*(uint32x2_t *) &__reint_211, __p3_211), vget_lane_u32(*(uint32x2_t *) &__reint_211, __p3_211), vget_lane_u32(*(uint32x2_t *) &__reint_211, __p3_211)}; \
37250 __ret_211 = vcmlaq_f16(__s0_211, __s1_211, *(float16x8_t *) &__reint1_211); \
37251 __ret_211; \
37252})
3591437253#else
35915__ai int8x16_t vbcaxq_s8(int8x16_t __p0, int8x16_t __p1, int8x16_t __p2) {
35916 int8x16_t __ret;
35917 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
35918 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
35919 int8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
35920 __ret = (int8x16_t) __builtin_neon_vbcaxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 32);
35921 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
35922 return __ret;
35923}
37254#define vcmlaq_lane_f16(__p0_212, __p1_212, __p2_212, __p3_212) __extension__ ({ \
37255 float16x8_t __ret_212; \
37256 float16x8_t __s0_212 = __p0_212; \
37257 float16x8_t __s1_212 = __p1_212; \
37258 float16x4_t __s2_212 = __p2_212; \
37259 float16x8_t __rev0_212; __rev0_212 = __builtin_shufflevector(__s0_212, __s0_212, 7, 6, 5, 4, 3, 2, 1, 0); \
37260 float16x8_t __rev1_212; __rev1_212 = __builtin_shufflevector(__s1_212, __s1_212, 7, 6, 5, 4, 3, 2, 1, 0); \
37261 float16x4_t __rev2_212; __rev2_212 = __builtin_shufflevector(__s2_212, __s2_212, 3, 2, 1, 0); \
37262float16x4_t __reint_212 = __rev2_212; \
37263uint32x4_t __reint1_212 = (uint32x4_t) {__noswap_vget_lane_u32(*(uint32x2_t *) &__reint_212, __p3_212), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_212, __p3_212), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_212, __p3_212), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_212, __p3_212)}; \
37264 __ret_212 = __noswap_vcmlaq_f16(__rev0_212, __rev1_212, *(float16x8_t *) &__reint1_212); \
37265 __ret_212 = __builtin_shufflevector(__ret_212, __ret_212, 7, 6, 5, 4, 3, 2, 1, 0); \
37266 __ret_212; \
37267})
3592437268#endif
3592537269
3592637270#ifdef __LITTLE_ENDIAN__
35927__ai int32x4_t vbcaxq_s32(int32x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
35928 int32x4_t __ret;
35929 __ret = (int32x4_t) __builtin_neon_vbcaxq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 34);
35930 return __ret;
35931}
37271#define vcmla_laneq_f16(__p0_213, __p1_213, __p2_213, __p3_213) __extension__ ({ \
37272 float16x4_t __ret_213; \
37273 float16x4_t __s0_213 = __p0_213; \
37274 float16x4_t __s1_213 = __p1_213; \
37275 float16x8_t __s2_213 = __p2_213; \
37276float16x8_t __reint_213 = __s2_213; \
37277uint32x2_t __reint1_213 = (uint32x2_t) {vgetq_lane_u32(*(uint32x4_t *) &__reint_213, __p3_213), vgetq_lane_u32(*(uint32x4_t *) &__reint_213, __p3_213)}; \
37278 __ret_213 = vcmla_f16(__s0_213, __s1_213, *(float16x4_t *) &__reint1_213); \
37279 __ret_213; \
37280})
3593237281#else
35933__ai int32x4_t vbcaxq_s32(int32x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
35934 int32x4_t __ret;
35935 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
35936 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
35937 int32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
35938 __ret = (int32x4_t) __builtin_neon_vbcaxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 34);
35939 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
35940 return __ret;
35941}
37282#define vcmla_laneq_f16(__p0_214, __p1_214, __p2_214, __p3_214) __extension__ ({ \
37283 float16x4_t __ret_214; \
37284 float16x4_t __s0_214 = __p0_214; \
37285 float16x4_t __s1_214 = __p1_214; \
37286 float16x8_t __s2_214 = __p2_214; \
37287 float16x4_t __rev0_214; __rev0_214 = __builtin_shufflevector(__s0_214, __s0_214, 3, 2, 1, 0); \
37288 float16x4_t __rev1_214; __rev1_214 = __builtin_shufflevector(__s1_214, __s1_214, 3, 2, 1, 0); \
37289 float16x8_t __rev2_214; __rev2_214 = __builtin_shufflevector(__s2_214, __s2_214, 7, 6, 5, 4, 3, 2, 1, 0); \
37290float16x8_t __reint_214 = __rev2_214; \
37291uint32x2_t __reint1_214 = (uint32x2_t) {__noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_214, __p3_214), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_214, __p3_214)}; \
37292 __ret_214 = __noswap_vcmla_f16(__rev0_214, __rev1_214, *(float16x4_t *) &__reint1_214); \
37293 __ret_214 = __builtin_shufflevector(__ret_214, __ret_214, 3, 2, 1, 0); \
37294 __ret_214; \
37295})
3594237296#endif
3594337297
3594437298#ifdef __LITTLE_ENDIAN__
35945__ai int64x2_t vbcaxq_s64(int64x2_t __p0, int64x2_t __p1, int64x2_t __p2) {
35946 int64x2_t __ret;
35947 __ret = (int64x2_t) __builtin_neon_vbcaxq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 35);
35948 return __ret;
35949}
37299#define vcmlaq_laneq_f16(__p0_215, __p1_215, __p2_215, __p3_215) __extension__ ({ \
37300 float16x8_t __ret_215; \
37301 float16x8_t __s0_215 = __p0_215; \
37302 float16x8_t __s1_215 = __p1_215; \
37303 float16x8_t __s2_215 = __p2_215; \
37304float16x8_t __reint_215 = __s2_215; \
37305uint32x4_t __reint1_215 = (uint32x4_t) {vgetq_lane_u32(*(uint32x4_t *) &__reint_215, __p3_215), vgetq_lane_u32(*(uint32x4_t *) &__reint_215, __p3_215), vgetq_lane_u32(*(uint32x4_t *) &__reint_215, __p3_215), vgetq_lane_u32(*(uint32x4_t *) &__reint_215, __p3_215)}; \
37306 __ret_215 = vcmlaq_f16(__s0_215, __s1_215, *(float16x8_t *) &__reint1_215); \
37307 __ret_215; \
37308})
3595037309#else
35951__ai int64x2_t vbcaxq_s64(int64x2_t __p0, int64x2_t __p1, int64x2_t __p2) {
35952 int64x2_t __ret;
35953 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
35954 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
35955 int64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
35956 __ret = (int64x2_t) __builtin_neon_vbcaxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 35);
35957 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
35958 return __ret;
35959}
37310#define vcmlaq_laneq_f16(__p0_216, __p1_216, __p2_216, __p3_216) __extension__ ({ \
37311 float16x8_t __ret_216; \
37312 float16x8_t __s0_216 = __p0_216; \
37313 float16x8_t __s1_216 = __p1_216; \
37314 float16x8_t __s2_216 = __p2_216; \
37315 float16x8_t __rev0_216; __rev0_216 = __builtin_shufflevector(__s0_216, __s0_216, 7, 6, 5, 4, 3, 2, 1, 0); \
37316 float16x8_t __rev1_216; __rev1_216 = __builtin_shufflevector(__s1_216, __s1_216, 7, 6, 5, 4, 3, 2, 1, 0); \
37317 float16x8_t __rev2_216; __rev2_216 = __builtin_shufflevector(__s2_216, __s2_216, 7, 6, 5, 4, 3, 2, 1, 0); \
37318float16x8_t __reint_216 = __rev2_216; \
37319uint32x4_t __reint1_216 = (uint32x4_t) {__noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_216, __p3_216), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_216, __p3_216), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_216, __p3_216), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_216, __p3_216)}; \
37320 __ret_216 = __noswap_vcmlaq_f16(__rev0_216, __rev1_216, *(float16x8_t *) &__reint1_216); \
37321 __ret_216 = __builtin_shufflevector(__ret_216, __ret_216, 7, 6, 5, 4, 3, 2, 1, 0); \
37322 __ret_216; \
37323})
3596037324#endif
3596137325
3596237326#ifdef __LITTLE_ENDIAN__
35963__ai int16x8_t vbcaxq_s16(int16x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
35964 int16x8_t __ret;
35965 __ret = (int16x8_t) __builtin_neon_vbcaxq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 33);
37327__ai __attribute__((target("v8.3a,fullfp16"))) float16x8_t vcmlaq_rot180_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
37328 float16x8_t __ret;
37329 __ret = (float16x8_t) __builtin_neon_vcmlaq_rot180_f16((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 40);
3596637330 return __ret;
3596737331}
3596837332#else
35969__ai int16x8_t vbcaxq_s16(int16x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
35970 int16x8_t __ret;
35971 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
35972 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
35973 int16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
35974 __ret = (int16x8_t) __builtin_neon_vbcaxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 33);
37333__ai __attribute__((target("v8.3a,fullfp16"))) float16x8_t vcmlaq_rot180_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
37334 float16x8_t __ret;
37335 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
37336 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
37337 float16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
37338 __ret = (float16x8_t) __builtin_neon_vcmlaq_rot180_f16((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 40);
3597537339 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
3597637340 return __ret;
3597737341}
35978#endif
35979
35980#ifdef __LITTLE_ENDIAN__
35981__ai uint8x16_t veor3q_u8(uint8x16_t __p0, uint8x16_t __p1, uint8x16_t __p2) {
35982 uint8x16_t __ret;
35983 __ret = (uint8x16_t) __builtin_neon_veor3q_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 48);
35984 return __ret;
35985}
35986#else
35987__ai uint8x16_t veor3q_u8(uint8x16_t __p0, uint8x16_t __p1, uint8x16_t __p2) {
35988 uint8x16_t __ret;
35989 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
35990 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
35991 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
35992 __ret = (uint8x16_t) __builtin_neon_veor3q_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 48);
35993 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
37342__ai __attribute__((target("v8.3a,fullfp16"))) float16x8_t __noswap_vcmlaq_rot180_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
37343 float16x8_t __ret;
37344 __ret = (float16x8_t) __builtin_neon_vcmlaq_rot180_f16((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 40);
3599437345 return __ret;
3599537346}
3599637347#endif
3599737348
3599837349#ifdef __LITTLE_ENDIAN__
35999__ai uint32x4_t veor3q_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
36000 uint32x4_t __ret;
36001 __ret = (uint32x4_t) __builtin_neon_veor3q_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 50);
37350__ai __attribute__((target("v8.3a,fullfp16"))) float16x4_t vcmla_rot180_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
37351 float16x4_t __ret;
37352 __ret = (float16x4_t) __builtin_neon_vcmla_rot180_f16((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 8);
3600237353 return __ret;
3600337354}
3600437355#else
36005__ai uint32x4_t veor3q_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
36006 uint32x4_t __ret;
36007 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
36008 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
36009 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
36010 __ret = (uint32x4_t) __builtin_neon_veor3q_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 50);
37356__ai __attribute__((target("v8.3a,fullfp16"))) float16x4_t vcmla_rot180_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
37357 float16x4_t __ret;
37358 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
37359 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
37360 float16x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
37361 __ret = (float16x4_t) __builtin_neon_vcmla_rot180_f16((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 8);
3601137362 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3601237363 return __ret;
3601337364}
36014#endif
36015
36016#ifdef __LITTLE_ENDIAN__
36017__ai uint64x2_t veor3q_u64(uint64x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
36018 uint64x2_t __ret;
36019 __ret = (uint64x2_t) __builtin_neon_veor3q_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 51);
36020 return __ret;
36021}
36022#else
36023__ai uint64x2_t veor3q_u64(uint64x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
36024 uint64x2_t __ret;
36025 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
36026 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
36027 uint64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
36028 __ret = (uint64x2_t) __builtin_neon_veor3q_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 51);
36029 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
37365__ai __attribute__((target("v8.3a,fullfp16"))) float16x4_t __noswap_vcmla_rot180_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
37366 float16x4_t __ret;
37367 __ret = (float16x4_t) __builtin_neon_vcmla_rot180_f16((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 8);
3603037368 return __ret;
3603137369}
3603237370#endif
3603337371
3603437372#ifdef __LITTLE_ENDIAN__
36035__ai uint16x8_t veor3q_u16(uint16x8_t __p0, uint16x8_t __p1, uint16x8_t __p2) {
36036 uint16x8_t __ret;
36037 __ret = (uint16x8_t) __builtin_neon_veor3q_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 49);
36038 return __ret;
36039}
37373#define vcmla_rot180_lane_f16(__p0_217, __p1_217, __p2_217, __p3_217) __extension__ ({ \
37374 float16x4_t __ret_217; \
37375 float16x4_t __s0_217 = __p0_217; \
37376 float16x4_t __s1_217 = __p1_217; \
37377 float16x4_t __s2_217 = __p2_217; \
37378float16x4_t __reint_217 = __s2_217; \
37379uint32x2_t __reint1_217 = (uint32x2_t) {vget_lane_u32(*(uint32x2_t *) &__reint_217, __p3_217), vget_lane_u32(*(uint32x2_t *) &__reint_217, __p3_217)}; \
37380 __ret_217 = vcmla_rot180_f16(__s0_217, __s1_217, *(float16x4_t *) &__reint1_217); \
37381 __ret_217; \
37382})
3604037383#else
36041__ai uint16x8_t veor3q_u16(uint16x8_t __p0, uint16x8_t __p1, uint16x8_t __p2) {
36042 uint16x8_t __ret;
36043 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
36044 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
36045 uint16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
36046 __ret = (uint16x8_t) __builtin_neon_veor3q_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 49);
36047 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
36048 return __ret;
36049}
37384#define vcmla_rot180_lane_f16(__p0_218, __p1_218, __p2_218, __p3_218) __extension__ ({ \
37385 float16x4_t __ret_218; \
37386 float16x4_t __s0_218 = __p0_218; \
37387 float16x4_t __s1_218 = __p1_218; \
37388 float16x4_t __s2_218 = __p2_218; \
37389 float16x4_t __rev0_218; __rev0_218 = __builtin_shufflevector(__s0_218, __s0_218, 3, 2, 1, 0); \
37390 float16x4_t __rev1_218; __rev1_218 = __builtin_shufflevector(__s1_218, __s1_218, 3, 2, 1, 0); \
37391 float16x4_t __rev2_218; __rev2_218 = __builtin_shufflevector(__s2_218, __s2_218, 3, 2, 1, 0); \
37392float16x4_t __reint_218 = __rev2_218; \
37393uint32x2_t __reint1_218 = (uint32x2_t) {__noswap_vget_lane_u32(*(uint32x2_t *) &__reint_218, __p3_218), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_218, __p3_218)}; \
37394 __ret_218 = __noswap_vcmla_rot180_f16(__rev0_218, __rev1_218, *(float16x4_t *) &__reint1_218); \
37395 __ret_218 = __builtin_shufflevector(__ret_218, __ret_218, 3, 2, 1, 0); \
37396 __ret_218; \
37397})
3605037398#endif
3605137399
3605237400#ifdef __LITTLE_ENDIAN__
36053__ai int8x16_t veor3q_s8(int8x16_t __p0, int8x16_t __p1, int8x16_t __p2) {
36054 int8x16_t __ret;
36055 __ret = (int8x16_t) __builtin_neon_veor3q_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 32);
36056 return __ret;
36057}
37401#define vcmlaq_rot180_lane_f16(__p0_219, __p1_219, __p2_219, __p3_219) __extension__ ({ \
37402 float16x8_t __ret_219; \
37403 float16x8_t __s0_219 = __p0_219; \
37404 float16x8_t __s1_219 = __p1_219; \
37405 float16x4_t __s2_219 = __p2_219; \
37406float16x4_t __reint_219 = __s2_219; \
37407uint32x4_t __reint1_219 = (uint32x4_t) {vget_lane_u32(*(uint32x2_t *) &__reint_219, __p3_219), vget_lane_u32(*(uint32x2_t *) &__reint_219, __p3_219), vget_lane_u32(*(uint32x2_t *) &__reint_219, __p3_219), vget_lane_u32(*(uint32x2_t *) &__reint_219, __p3_219)}; \
37408 __ret_219 = vcmlaq_rot180_f16(__s0_219, __s1_219, *(float16x8_t *) &__reint1_219); \
37409 __ret_219; \
37410})
3605837411#else
36059__ai int8x16_t veor3q_s8(int8x16_t __p0, int8x16_t __p1, int8x16_t __p2) {
36060 int8x16_t __ret;
36061 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
36062 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
36063 int8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
36064 __ret = (int8x16_t) __builtin_neon_veor3q_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 32);
36065 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
36066 return __ret;
36067}
37412#define vcmlaq_rot180_lane_f16(__p0_220, __p1_220, __p2_220, __p3_220) __extension__ ({ \
37413 float16x8_t __ret_220; \
37414 float16x8_t __s0_220 = __p0_220; \
37415 float16x8_t __s1_220 = __p1_220; \
37416 float16x4_t __s2_220 = __p2_220; \
37417 float16x8_t __rev0_220; __rev0_220 = __builtin_shufflevector(__s0_220, __s0_220, 7, 6, 5, 4, 3, 2, 1, 0); \
37418 float16x8_t __rev1_220; __rev1_220 = __builtin_shufflevector(__s1_220, __s1_220, 7, 6, 5, 4, 3, 2, 1, 0); \
37419 float16x4_t __rev2_220; __rev2_220 = __builtin_shufflevector(__s2_220, __s2_220, 3, 2, 1, 0); \
37420float16x4_t __reint_220 = __rev2_220; \
37421uint32x4_t __reint1_220 = (uint32x4_t) {__noswap_vget_lane_u32(*(uint32x2_t *) &__reint_220, __p3_220), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_220, __p3_220), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_220, __p3_220), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_220, __p3_220)}; \
37422 __ret_220 = __noswap_vcmlaq_rot180_f16(__rev0_220, __rev1_220, *(float16x8_t *) &__reint1_220); \
37423 __ret_220 = __builtin_shufflevector(__ret_220, __ret_220, 7, 6, 5, 4, 3, 2, 1, 0); \
37424 __ret_220; \
37425})
3606837426#endif
3606937427
3607037428#ifdef __LITTLE_ENDIAN__
36071__ai int32x4_t veor3q_s32(int32x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
36072 int32x4_t __ret;
36073 __ret = (int32x4_t) __builtin_neon_veor3q_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 34);
36074 return __ret;
36075}
37429#define vcmla_rot180_laneq_f16(__p0_221, __p1_221, __p2_221, __p3_221) __extension__ ({ \
37430 float16x4_t __ret_221; \
37431 float16x4_t __s0_221 = __p0_221; \
37432 float16x4_t __s1_221 = __p1_221; \
37433 float16x8_t __s2_221 = __p2_221; \
37434float16x8_t __reint_221 = __s2_221; \
37435uint32x2_t __reint1_221 = (uint32x2_t) {vgetq_lane_u32(*(uint32x4_t *) &__reint_221, __p3_221), vgetq_lane_u32(*(uint32x4_t *) &__reint_221, __p3_221)}; \
37436 __ret_221 = vcmla_rot180_f16(__s0_221, __s1_221, *(float16x4_t *) &__reint1_221); \
37437 __ret_221; \
37438})
3607637439#else
36077__ai int32x4_t veor3q_s32(int32x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
36078 int32x4_t __ret;
36079 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
36080 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
36081 int32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
36082 __ret = (int32x4_t) __builtin_neon_veor3q_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 34);
36083 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
36084 return __ret;
36085}
37440#define vcmla_rot180_laneq_f16(__p0_222, __p1_222, __p2_222, __p3_222) __extension__ ({ \
37441 float16x4_t __ret_222; \
37442 float16x4_t __s0_222 = __p0_222; \
37443 float16x4_t __s1_222 = __p1_222; \
37444 float16x8_t __s2_222 = __p2_222; \
37445 float16x4_t __rev0_222; __rev0_222 = __builtin_shufflevector(__s0_222, __s0_222, 3, 2, 1, 0); \
37446 float16x4_t __rev1_222; __rev1_222 = __builtin_shufflevector(__s1_222, __s1_222, 3, 2, 1, 0); \
37447 float16x8_t __rev2_222; __rev2_222 = __builtin_shufflevector(__s2_222, __s2_222, 7, 6, 5, 4, 3, 2, 1, 0); \
37448float16x8_t __reint_222 = __rev2_222; \
37449uint32x2_t __reint1_222 = (uint32x2_t) {__noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_222, __p3_222), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_222, __p3_222)}; \
37450 __ret_222 = __noswap_vcmla_rot180_f16(__rev0_222, __rev1_222, *(float16x4_t *) &__reint1_222); \
37451 __ret_222 = __builtin_shufflevector(__ret_222, __ret_222, 3, 2, 1, 0); \
37452 __ret_222; \
37453})
3608637454#endif
3608737455
3608837456#ifdef __LITTLE_ENDIAN__
36089__ai int64x2_t veor3q_s64(int64x2_t __p0, int64x2_t __p1, int64x2_t __p2) {
36090 int64x2_t __ret;
36091 __ret = (int64x2_t) __builtin_neon_veor3q_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 35);
36092 return __ret;
36093}
37457#define vcmlaq_rot180_laneq_f16(__p0_223, __p1_223, __p2_223, __p3_223) __extension__ ({ \
37458 float16x8_t __ret_223; \
37459 float16x8_t __s0_223 = __p0_223; \
37460 float16x8_t __s1_223 = __p1_223; \
37461 float16x8_t __s2_223 = __p2_223; \
37462float16x8_t __reint_223 = __s2_223; \
37463uint32x4_t __reint1_223 = (uint32x4_t) {vgetq_lane_u32(*(uint32x4_t *) &__reint_223, __p3_223), vgetq_lane_u32(*(uint32x4_t *) &__reint_223, __p3_223), vgetq_lane_u32(*(uint32x4_t *) &__reint_223, __p3_223), vgetq_lane_u32(*(uint32x4_t *) &__reint_223, __p3_223)}; \
37464 __ret_223 = vcmlaq_rot180_f16(__s0_223, __s1_223, *(float16x8_t *) &__reint1_223); \
37465 __ret_223; \
37466})
3609437467#else
36095__ai int64x2_t veor3q_s64(int64x2_t __p0, int64x2_t __p1, int64x2_t __p2) {
36096 int64x2_t __ret;
36097 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
36098 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
36099 int64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
36100 __ret = (int64x2_t) __builtin_neon_veor3q_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 35);
36101 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
36102 return __ret;
36103}
37468#define vcmlaq_rot180_laneq_f16(__p0_224, __p1_224, __p2_224, __p3_224) __extension__ ({ \
37469 float16x8_t __ret_224; \
37470 float16x8_t __s0_224 = __p0_224; \
37471 float16x8_t __s1_224 = __p1_224; \
37472 float16x8_t __s2_224 = __p2_224; \
37473 float16x8_t __rev0_224; __rev0_224 = __builtin_shufflevector(__s0_224, __s0_224, 7, 6, 5, 4, 3, 2, 1, 0); \
37474 float16x8_t __rev1_224; __rev1_224 = __builtin_shufflevector(__s1_224, __s1_224, 7, 6, 5, 4, 3, 2, 1, 0); \
37475 float16x8_t __rev2_224; __rev2_224 = __builtin_shufflevector(__s2_224, __s2_224, 7, 6, 5, 4, 3, 2, 1, 0); \
37476float16x8_t __reint_224 = __rev2_224; \
37477uint32x4_t __reint1_224 = (uint32x4_t) {__noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_224, __p3_224), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_224, __p3_224), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_224, __p3_224), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_224, __p3_224)}; \
37478 __ret_224 = __noswap_vcmlaq_rot180_f16(__rev0_224, __rev1_224, *(float16x8_t *) &__reint1_224); \
37479 __ret_224 = __builtin_shufflevector(__ret_224, __ret_224, 7, 6, 5, 4, 3, 2, 1, 0); \
37480 __ret_224; \
37481})
3610437482#endif
3610537483
3610637484#ifdef __LITTLE_ENDIAN__
36107__ai int16x8_t veor3q_s16(int16x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
36108 int16x8_t __ret;
36109 __ret = (int16x8_t) __builtin_neon_veor3q_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 33);
37485__ai __attribute__((target("v8.3a,fullfp16"))) float16x8_t vcmlaq_rot270_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
37486 float16x8_t __ret;
37487 __ret = (float16x8_t) __builtin_neon_vcmlaq_rot270_f16((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 40);
3611037488 return __ret;
3611137489}
3611237490#else
36113__ai int16x8_t veor3q_s16(int16x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
36114 int16x8_t __ret;
36115 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
36116 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
36117 int16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
36118 __ret = (int16x8_t) __builtin_neon_veor3q_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 33);
37491__ai __attribute__((target("v8.3a,fullfp16"))) float16x8_t vcmlaq_rot270_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
37492 float16x8_t __ret;
37493 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
37494 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
37495 float16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
37496 __ret = (float16x8_t) __builtin_neon_vcmlaq_rot270_f16((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 40);
3611937497 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
3612037498 return __ret;
3612137499}
37500__ai __attribute__((target("v8.3a,fullfp16"))) float16x8_t __noswap_vcmlaq_rot270_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
37501 float16x8_t __ret;
37502 __ret = (float16x8_t) __builtin_neon_vcmlaq_rot270_f16((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 40);
37503 return __ret;
37504}
3612237505#endif
3612337506
3612437507#ifdef __LITTLE_ENDIAN__
36125__ai uint64x2_t vrax1q_u64(uint64x2_t __p0, uint64x2_t __p1) {
36126 uint64x2_t __ret;
36127 __ret = (uint64x2_t) __builtin_neon_vrax1q_v((int8x16_t)__p0, (int8x16_t)__p1, 51);
37508__ai __attribute__((target("v8.3a,fullfp16"))) float16x4_t vcmla_rot270_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
37509 float16x4_t __ret;
37510 __ret = (float16x4_t) __builtin_neon_vcmla_rot270_f16((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 8);
3612837511 return __ret;
3612937512}
3613037513#else
36131__ai uint64x2_t vrax1q_u64(uint64x2_t __p0, uint64x2_t __p1) {
36132 uint64x2_t __ret;
36133 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
36134 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
36135 __ret = (uint64x2_t) __builtin_neon_vrax1q_v((int8x16_t)__rev0, (int8x16_t)__rev1, 51);
36136 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
37514__ai __attribute__((target("v8.3a,fullfp16"))) float16x4_t vcmla_rot270_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
37515 float16x4_t __ret;
37516 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
37517 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
37518 float16x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
37519 __ret = (float16x4_t) __builtin_neon_vcmla_rot270_f16((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 8);
37520 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
37521 return __ret;
37522}
37523__ai __attribute__((target("v8.3a,fullfp16"))) float16x4_t __noswap_vcmla_rot270_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
37524 float16x4_t __ret;
37525 __ret = (float16x4_t) __builtin_neon_vcmla_rot270_f16((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 8);
3613737526 return __ret;
3613837527}
3613937528#endif
3614037529
3614137530#ifdef __LITTLE_ENDIAN__
36142#define vxarq_u64(__p0, __p1, __p2) __extension__ ({ \
36143 uint64x2_t __ret; \
36144 uint64x2_t __s0 = __p0; \
36145 uint64x2_t __s1 = __p1; \
36146 __ret = (uint64x2_t) __builtin_neon_vxarq_v((int8x16_t)__s0, (int8x16_t)__s1, __p2, 51); \
36147 __ret; \
37531#define vcmla_rot270_lane_f16(__p0_225, __p1_225, __p2_225, __p3_225) __extension__ ({ \
37532 float16x4_t __ret_225; \
37533 float16x4_t __s0_225 = __p0_225; \
37534 float16x4_t __s1_225 = __p1_225; \
37535 float16x4_t __s2_225 = __p2_225; \
37536float16x4_t __reint_225 = __s2_225; \
37537uint32x2_t __reint1_225 = (uint32x2_t) {vget_lane_u32(*(uint32x2_t *) &__reint_225, __p3_225), vget_lane_u32(*(uint32x2_t *) &__reint_225, __p3_225)}; \
37538 __ret_225 = vcmla_rot270_f16(__s0_225, __s1_225, *(float16x4_t *) &__reint1_225); \
37539 __ret_225; \
3614837540})
3614937541#else
36150#define vxarq_u64(__p0, __p1, __p2) __extension__ ({ \
36151 uint64x2_t __ret; \
36152 uint64x2_t __s0 = __p0; \
36153 uint64x2_t __s1 = __p1; \
36154 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
36155 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
36156 __ret = (uint64x2_t) __builtin_neon_vxarq_v((int8x16_t)__rev0, (int8x16_t)__rev1, __p2, 51); \
36157 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
36158 __ret; \
37542#define vcmla_rot270_lane_f16(__p0_226, __p1_226, __p2_226, __p3_226) __extension__ ({ \
37543 float16x4_t __ret_226; \
37544 float16x4_t __s0_226 = __p0_226; \
37545 float16x4_t __s1_226 = __p1_226; \
37546 float16x4_t __s2_226 = __p2_226; \
37547 float16x4_t __rev0_226; __rev0_226 = __builtin_shufflevector(__s0_226, __s0_226, 3, 2, 1, 0); \
37548 float16x4_t __rev1_226; __rev1_226 = __builtin_shufflevector(__s1_226, __s1_226, 3, 2, 1, 0); \
37549 float16x4_t __rev2_226; __rev2_226 = __builtin_shufflevector(__s2_226, __s2_226, 3, 2, 1, 0); \
37550float16x4_t __reint_226 = __rev2_226; \
37551uint32x2_t __reint1_226 = (uint32x2_t) {__noswap_vget_lane_u32(*(uint32x2_t *) &__reint_226, __p3_226), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_226, __p3_226)}; \
37552 __ret_226 = __noswap_vcmla_rot270_f16(__rev0_226, __rev1_226, *(float16x4_t *) &__reint1_226); \
37553 __ret_226 = __builtin_shufflevector(__ret_226, __ret_226, 3, 2, 1, 0); \
37554 __ret_226; \
3615937555})
3616037556#endif
3616137557
36162#endif
36163#if __ARM_ARCH >= 8 && defined(__ARM_FEATURE_SHA512) && defined(__aarch64__)
3616437558#ifdef __LITTLE_ENDIAN__
36165__ai uint64x2_t vsha512hq_u64(uint64x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
36166 uint64x2_t __ret;
36167 __ret = (uint64x2_t) __builtin_neon_vsha512hq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 51);
36168 return __ret;
36169}
37559#define vcmlaq_rot270_lane_f16(__p0_227, __p1_227, __p2_227, __p3_227) __extension__ ({ \
37560 float16x8_t __ret_227; \
37561 float16x8_t __s0_227 = __p0_227; \
37562 float16x8_t __s1_227 = __p1_227; \
37563 float16x4_t __s2_227 = __p2_227; \
37564float16x4_t __reint_227 = __s2_227; \
37565uint32x4_t __reint1_227 = (uint32x4_t) {vget_lane_u32(*(uint32x2_t *) &__reint_227, __p3_227), vget_lane_u32(*(uint32x2_t *) &__reint_227, __p3_227), vget_lane_u32(*(uint32x2_t *) &__reint_227, __p3_227), vget_lane_u32(*(uint32x2_t *) &__reint_227, __p3_227)}; \
37566 __ret_227 = vcmlaq_rot270_f16(__s0_227, __s1_227, *(float16x8_t *) &__reint1_227); \
37567 __ret_227; \
37568})
3617037569#else
36171__ai uint64x2_t vsha512hq_u64(uint64x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
36172 uint64x2_t __ret;
36173 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
36174 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
36175 uint64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
36176 __ret = (uint64x2_t) __builtin_neon_vsha512hq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 51);
36177 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
36178 return __ret;
36179}
37570#define vcmlaq_rot270_lane_f16(__p0_228, __p1_228, __p2_228, __p3_228) __extension__ ({ \
37571 float16x8_t __ret_228; \
37572 float16x8_t __s0_228 = __p0_228; \
37573 float16x8_t __s1_228 = __p1_228; \
37574 float16x4_t __s2_228 = __p2_228; \
37575 float16x8_t __rev0_228; __rev0_228 = __builtin_shufflevector(__s0_228, __s0_228, 7, 6, 5, 4, 3, 2, 1, 0); \
37576 float16x8_t __rev1_228; __rev1_228 = __builtin_shufflevector(__s1_228, __s1_228, 7, 6, 5, 4, 3, 2, 1, 0); \
37577 float16x4_t __rev2_228; __rev2_228 = __builtin_shufflevector(__s2_228, __s2_228, 3, 2, 1, 0); \
37578float16x4_t __reint_228 = __rev2_228; \
37579uint32x4_t __reint1_228 = (uint32x4_t) {__noswap_vget_lane_u32(*(uint32x2_t *) &__reint_228, __p3_228), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_228, __p3_228), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_228, __p3_228), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_228, __p3_228)}; \
37580 __ret_228 = __noswap_vcmlaq_rot270_f16(__rev0_228, __rev1_228, *(float16x8_t *) &__reint1_228); \
37581 __ret_228 = __builtin_shufflevector(__ret_228, __ret_228, 7, 6, 5, 4, 3, 2, 1, 0); \
37582 __ret_228; \
37583})
3618037584#endif
3618137585
3618237586#ifdef __LITTLE_ENDIAN__
36183__ai uint64x2_t vsha512h2q_u64(uint64x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
36184 uint64x2_t __ret;
36185 __ret = (uint64x2_t) __builtin_neon_vsha512h2q_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 51);
36186 return __ret;
36187}
37587#define vcmla_rot270_laneq_f16(__p0_229, __p1_229, __p2_229, __p3_229) __extension__ ({ \
37588 float16x4_t __ret_229; \
37589 float16x4_t __s0_229 = __p0_229; \
37590 float16x4_t __s1_229 = __p1_229; \
37591 float16x8_t __s2_229 = __p2_229; \
37592float16x8_t __reint_229 = __s2_229; \
37593uint32x2_t __reint1_229 = (uint32x2_t) {vgetq_lane_u32(*(uint32x4_t *) &__reint_229, __p3_229), vgetq_lane_u32(*(uint32x4_t *) &__reint_229, __p3_229)}; \
37594 __ret_229 = vcmla_rot270_f16(__s0_229, __s1_229, *(float16x4_t *) &__reint1_229); \
37595 __ret_229; \
37596})
3618837597#else
36189__ai uint64x2_t vsha512h2q_u64(uint64x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
36190 uint64x2_t __ret;
36191 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
36192 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
36193 uint64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
36194 __ret = (uint64x2_t) __builtin_neon_vsha512h2q_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 51);
36195 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
36196 return __ret;
36197}
37598#define vcmla_rot270_laneq_f16(__p0_230, __p1_230, __p2_230, __p3_230) __extension__ ({ \
37599 float16x4_t __ret_230; \
37600 float16x4_t __s0_230 = __p0_230; \
37601 float16x4_t __s1_230 = __p1_230; \
37602 float16x8_t __s2_230 = __p2_230; \
37603 float16x4_t __rev0_230; __rev0_230 = __builtin_shufflevector(__s0_230, __s0_230, 3, 2, 1, 0); \
37604 float16x4_t __rev1_230; __rev1_230 = __builtin_shufflevector(__s1_230, __s1_230, 3, 2, 1, 0); \
37605 float16x8_t __rev2_230; __rev2_230 = __builtin_shufflevector(__s2_230, __s2_230, 7, 6, 5, 4, 3, 2, 1, 0); \
37606float16x8_t __reint_230 = __rev2_230; \
37607uint32x2_t __reint1_230 = (uint32x2_t) {__noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_230, __p3_230), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_230, __p3_230)}; \
37608 __ret_230 = __noswap_vcmla_rot270_f16(__rev0_230, __rev1_230, *(float16x4_t *) &__reint1_230); \
37609 __ret_230 = __builtin_shufflevector(__ret_230, __ret_230, 3, 2, 1, 0); \
37610 __ret_230; \
37611})
3619837612#endif
3619937613
3620037614#ifdef __LITTLE_ENDIAN__
36201__ai uint64x2_t vsha512su0q_u64(uint64x2_t __p0, uint64x2_t __p1) {
36202 uint64x2_t __ret;
36203 __ret = (uint64x2_t) __builtin_neon_vsha512su0q_v((int8x16_t)__p0, (int8x16_t)__p1, 51);
36204 return __ret;
36205}
37615#define vcmlaq_rot270_laneq_f16(__p0_231, __p1_231, __p2_231, __p3_231) __extension__ ({ \
37616 float16x8_t __ret_231; \
37617 float16x8_t __s0_231 = __p0_231; \
37618 float16x8_t __s1_231 = __p1_231; \
37619 float16x8_t __s2_231 = __p2_231; \
37620float16x8_t __reint_231 = __s2_231; \
37621uint32x4_t __reint1_231 = (uint32x4_t) {vgetq_lane_u32(*(uint32x4_t *) &__reint_231, __p3_231), vgetq_lane_u32(*(uint32x4_t *) &__reint_231, __p3_231), vgetq_lane_u32(*(uint32x4_t *) &__reint_231, __p3_231), vgetq_lane_u32(*(uint32x4_t *) &__reint_231, __p3_231)}; \
37622 __ret_231 = vcmlaq_rot270_f16(__s0_231, __s1_231, *(float16x8_t *) &__reint1_231); \
37623 __ret_231; \
37624})
3620637625#else
36207__ai uint64x2_t vsha512su0q_u64(uint64x2_t __p0, uint64x2_t __p1) {
36208 uint64x2_t __ret;
36209 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
36210 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
36211 __ret = (uint64x2_t) __builtin_neon_vsha512su0q_v((int8x16_t)__rev0, (int8x16_t)__rev1, 51);
36212 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
36213 return __ret;
36214}
37626#define vcmlaq_rot270_laneq_f16(__p0_232, __p1_232, __p2_232, __p3_232) __extension__ ({ \
37627 float16x8_t __ret_232; \
37628 float16x8_t __s0_232 = __p0_232; \
37629 float16x8_t __s1_232 = __p1_232; \
37630 float16x8_t __s2_232 = __p2_232; \
37631 float16x8_t __rev0_232; __rev0_232 = __builtin_shufflevector(__s0_232, __s0_232, 7, 6, 5, 4, 3, 2, 1, 0); \
37632 float16x8_t __rev1_232; __rev1_232 = __builtin_shufflevector(__s1_232, __s1_232, 7, 6, 5, 4, 3, 2, 1, 0); \
37633 float16x8_t __rev2_232; __rev2_232 = __builtin_shufflevector(__s2_232, __s2_232, 7, 6, 5, 4, 3, 2, 1, 0); \
37634float16x8_t __reint_232 = __rev2_232; \
37635uint32x4_t __reint1_232 = (uint32x4_t) {__noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_232, __p3_232), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_232, __p3_232), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_232, __p3_232), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_232, __p3_232)}; \
37636 __ret_232 = __noswap_vcmlaq_rot270_f16(__rev0_232, __rev1_232, *(float16x8_t *) &__reint1_232); \
37637 __ret_232 = __builtin_shufflevector(__ret_232, __ret_232, 7, 6, 5, 4, 3, 2, 1, 0); \
37638 __ret_232; \
37639})
3621537640#endif
3621637641
3621737642#ifdef __LITTLE_ENDIAN__
36218__ai uint64x2_t vsha512su1q_u64(uint64x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
36219 uint64x2_t __ret;
36220 __ret = (uint64x2_t) __builtin_neon_vsha512su1q_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 51);
37643__ai __attribute__((target("v8.3a,fullfp16"))) float16x8_t vcmlaq_rot90_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
37644 float16x8_t __ret;
37645 __ret = (float16x8_t) __builtin_neon_vcmlaq_rot90_f16((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 40);
3622137646 return __ret;
3622237647}
3622337648#else
36224__ai uint64x2_t vsha512su1q_u64(uint64x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
36225 uint64x2_t __ret;
36226 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
36227 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
36228 uint64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
36229 __ret = (uint64x2_t) __builtin_neon_vsha512su1q_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 51);
36230 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
36231 return __ret;
36232}
36233#endif
36234
36235#endif
36236#if __ARM_ARCH >= 8 && defined(__ARM_FEATURE_SM3) && defined(__aarch64__)
36237#ifdef __LITTLE_ENDIAN__
36238__ai uint32x4_t vsm3partw1q_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
36239 uint32x4_t __ret;
36240 __ret = (uint32x4_t) __builtin_neon_vsm3partw1q_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 50);
37649__ai __attribute__((target("v8.3a,fullfp16"))) float16x8_t vcmlaq_rot90_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
37650 float16x8_t __ret;
37651 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
37652 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
37653 float16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
37654 __ret = (float16x8_t) __builtin_neon_vcmlaq_rot90_f16((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 40);
37655 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
3624137656 return __ret;
3624237657}
36243#else
36244__ai uint32x4_t vsm3partw1q_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
36245 uint32x4_t __ret;
36246 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
36247 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
36248 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
36249 __ret = (uint32x4_t) __builtin_neon_vsm3partw1q_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 50);
36250 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
37658__ai __attribute__((target("v8.3a,fullfp16"))) float16x8_t __noswap_vcmlaq_rot90_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
37659 float16x8_t __ret;
37660 __ret = (float16x8_t) __builtin_neon_vcmlaq_rot90_f16((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 40);
3625137661 return __ret;
3625237662}
3625337663#endif
3625437664
3625537665#ifdef __LITTLE_ENDIAN__
36256__ai uint32x4_t vsm3partw2q_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
36257 uint32x4_t __ret;
36258 __ret = (uint32x4_t) __builtin_neon_vsm3partw2q_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 50);
37666__ai __attribute__((target("v8.3a,fullfp16"))) float16x4_t vcmla_rot90_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
37667 float16x4_t __ret;
37668 __ret = (float16x4_t) __builtin_neon_vcmla_rot90_f16((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 8);
3625937669 return __ret;
3626037670}
3626137671#else
36262__ai uint32x4_t vsm3partw2q_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
36263 uint32x4_t __ret;
36264 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
36265 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
36266 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
36267 __ret = (uint32x4_t) __builtin_neon_vsm3partw2q_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 50);
37672__ai __attribute__((target("v8.3a,fullfp16"))) float16x4_t vcmla_rot90_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
37673 float16x4_t __ret;
37674 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
37675 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
37676 float16x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
37677 __ret = (float16x4_t) __builtin_neon_vcmla_rot90_f16((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 8);
3626837678 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3626937679 return __ret;
3627037680}
36271#endif
36272
36273#ifdef __LITTLE_ENDIAN__
36274__ai uint32x4_t vsm3ss1q_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
36275 uint32x4_t __ret;
36276 __ret = (uint32x4_t) __builtin_neon_vsm3ss1q_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 50);
36277 return __ret;
36278}
36279#else
36280__ai uint32x4_t vsm3ss1q_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
36281 uint32x4_t __ret;
36282 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
36283 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
36284 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
36285 __ret = (uint32x4_t) __builtin_neon_vsm3ss1q_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 50);
36286 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
37681__ai __attribute__((target("v8.3a,fullfp16"))) float16x4_t __noswap_vcmla_rot90_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
37682 float16x4_t __ret;
37683 __ret = (float16x4_t) __builtin_neon_vcmla_rot90_f16((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 8);
3628737684 return __ret;
3628837685}
3628937686#endif
3629037687
3629137688#ifdef __LITTLE_ENDIAN__
36292#define vsm3tt1aq_u32(__p0, __p1, __p2, __p3) __extension__ ({ \
36293 uint32x4_t __ret; \
36294 uint32x4_t __s0 = __p0; \
36295 uint32x4_t __s1 = __p1; \
36296 uint32x4_t __s2 = __p2; \
36297 __ret = (uint32x4_t) __builtin_neon_vsm3tt1aq_v((int8x16_t)__s0, (int8x16_t)__s1, (int8x16_t)__s2, __p3, 50); \
36298 __ret; \
37689#define vcmla_rot90_lane_f16(__p0_233, __p1_233, __p2_233, __p3_233) __extension__ ({ \
37690 float16x4_t __ret_233; \
37691 float16x4_t __s0_233 = __p0_233; \
37692 float16x4_t __s1_233 = __p1_233; \
37693 float16x4_t __s2_233 = __p2_233; \
37694float16x4_t __reint_233 = __s2_233; \
37695uint32x2_t __reint1_233 = (uint32x2_t) {vget_lane_u32(*(uint32x2_t *) &__reint_233, __p3_233), vget_lane_u32(*(uint32x2_t *) &__reint_233, __p3_233)}; \
37696 __ret_233 = vcmla_rot90_f16(__s0_233, __s1_233, *(float16x4_t *) &__reint1_233); \
37697 __ret_233; \
3629937698})
3630037699#else
36301#define vsm3tt1aq_u32(__p0, __p1, __p2, __p3) __extension__ ({ \
36302 uint32x4_t __ret; \
36303 uint32x4_t __s0 = __p0; \
36304 uint32x4_t __s1 = __p1; \
36305 uint32x4_t __s2 = __p2; \
36306 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
36307 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
36308 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 3, 2, 1, 0); \
36309 __ret = (uint32x4_t) __builtin_neon_vsm3tt1aq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, __p3, 50); \
36310 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
36311 __ret; \
37700#define vcmla_rot90_lane_f16(__p0_234, __p1_234, __p2_234, __p3_234) __extension__ ({ \
37701 float16x4_t __ret_234; \
37702 float16x4_t __s0_234 = __p0_234; \
37703 float16x4_t __s1_234 = __p1_234; \
37704 float16x4_t __s2_234 = __p2_234; \
37705 float16x4_t __rev0_234; __rev0_234 = __builtin_shufflevector(__s0_234, __s0_234, 3, 2, 1, 0); \
37706 float16x4_t __rev1_234; __rev1_234 = __builtin_shufflevector(__s1_234, __s1_234, 3, 2, 1, 0); \
37707 float16x4_t __rev2_234; __rev2_234 = __builtin_shufflevector(__s2_234, __s2_234, 3, 2, 1, 0); \
37708float16x4_t __reint_234 = __rev2_234; \
37709uint32x2_t __reint1_234 = (uint32x2_t) {__noswap_vget_lane_u32(*(uint32x2_t *) &__reint_234, __p3_234), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_234, __p3_234)}; \
37710 __ret_234 = __noswap_vcmla_rot90_f16(__rev0_234, __rev1_234, *(float16x4_t *) &__reint1_234); \
37711 __ret_234 = __builtin_shufflevector(__ret_234, __ret_234, 3, 2, 1, 0); \
37712 __ret_234; \
3631237713})
3631337714#endif
3631437715
3631537716#ifdef __LITTLE_ENDIAN__
36316#define vsm3tt1bq_u32(__p0, __p1, __p2, __p3) __extension__ ({ \
36317 uint32x4_t __ret; \
36318 uint32x4_t __s0 = __p0; \
36319 uint32x4_t __s1 = __p1; \
36320 uint32x4_t __s2 = __p2; \
36321 __ret = (uint32x4_t) __builtin_neon_vsm3tt1bq_v((int8x16_t)__s0, (int8x16_t)__s1, (int8x16_t)__s2, __p3, 50); \
36322 __ret; \
37717#define vcmlaq_rot90_lane_f16(__p0_235, __p1_235, __p2_235, __p3_235) __extension__ ({ \
37718 float16x8_t __ret_235; \
37719 float16x8_t __s0_235 = __p0_235; \
37720 float16x8_t __s1_235 = __p1_235; \
37721 float16x4_t __s2_235 = __p2_235; \
37722float16x4_t __reint_235 = __s2_235; \
37723uint32x4_t __reint1_235 = (uint32x4_t) {vget_lane_u32(*(uint32x2_t *) &__reint_235, __p3_235), vget_lane_u32(*(uint32x2_t *) &__reint_235, __p3_235), vget_lane_u32(*(uint32x2_t *) &__reint_235, __p3_235), vget_lane_u32(*(uint32x2_t *) &__reint_235, __p3_235)}; \
37724 __ret_235 = vcmlaq_rot90_f16(__s0_235, __s1_235, *(float16x8_t *) &__reint1_235); \
37725 __ret_235; \
3632337726})
3632437727#else
36325#define vsm3tt1bq_u32(__p0, __p1, __p2, __p3) __extension__ ({ \
36326 uint32x4_t __ret; \
36327 uint32x4_t __s0 = __p0; \
36328 uint32x4_t __s1 = __p1; \
36329 uint32x4_t __s2 = __p2; \
36330 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
36331 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
36332 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 3, 2, 1, 0); \
36333 __ret = (uint32x4_t) __builtin_neon_vsm3tt1bq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, __p3, 50); \
36334 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
36335 __ret; \
37728#define vcmlaq_rot90_lane_f16(__p0_236, __p1_236, __p2_236, __p3_236) __extension__ ({ \
37729 float16x8_t __ret_236; \
37730 float16x8_t __s0_236 = __p0_236; \
37731 float16x8_t __s1_236 = __p1_236; \
37732 float16x4_t __s2_236 = __p2_236; \
37733 float16x8_t __rev0_236; __rev0_236 = __builtin_shufflevector(__s0_236, __s0_236, 7, 6, 5, 4, 3, 2, 1, 0); \
37734 float16x8_t __rev1_236; __rev1_236 = __builtin_shufflevector(__s1_236, __s1_236, 7, 6, 5, 4, 3, 2, 1, 0); \
37735 float16x4_t __rev2_236; __rev2_236 = __builtin_shufflevector(__s2_236, __s2_236, 3, 2, 1, 0); \
37736float16x4_t __reint_236 = __rev2_236; \
37737uint32x4_t __reint1_236 = (uint32x4_t) {__noswap_vget_lane_u32(*(uint32x2_t *) &__reint_236, __p3_236), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_236, __p3_236), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_236, __p3_236), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_236, __p3_236)}; \
37738 __ret_236 = __noswap_vcmlaq_rot90_f16(__rev0_236, __rev1_236, *(float16x8_t *) &__reint1_236); \
37739 __ret_236 = __builtin_shufflevector(__ret_236, __ret_236, 7, 6, 5, 4, 3, 2, 1, 0); \
37740 __ret_236; \
3633637741})
3633737742#endif
3633837743
3633937744#ifdef __LITTLE_ENDIAN__
36340#define vsm3tt2aq_u32(__p0, __p1, __p2, __p3) __extension__ ({ \
36341 uint32x4_t __ret; \
36342 uint32x4_t __s0 = __p0; \
36343 uint32x4_t __s1 = __p1; \
36344 uint32x4_t __s2 = __p2; \
36345 __ret = (uint32x4_t) __builtin_neon_vsm3tt2aq_v((int8x16_t)__s0, (int8x16_t)__s1, (int8x16_t)__s2, __p3, 50); \
36346 __ret; \
37745#define vcmla_rot90_laneq_f16(__p0_237, __p1_237, __p2_237, __p3_237) __extension__ ({ \
37746 float16x4_t __ret_237; \
37747 float16x4_t __s0_237 = __p0_237; \
37748 float16x4_t __s1_237 = __p1_237; \
37749 float16x8_t __s2_237 = __p2_237; \
37750float16x8_t __reint_237 = __s2_237; \
37751uint32x2_t __reint1_237 = (uint32x2_t) {vgetq_lane_u32(*(uint32x4_t *) &__reint_237, __p3_237), vgetq_lane_u32(*(uint32x4_t *) &__reint_237, __p3_237)}; \
37752 __ret_237 = vcmla_rot90_f16(__s0_237, __s1_237, *(float16x4_t *) &__reint1_237); \
37753 __ret_237; \
3634737754})
3634837755#else
36349#define vsm3tt2aq_u32(__p0, __p1, __p2, __p3) __extension__ ({ \
36350 uint32x4_t __ret; \
36351 uint32x4_t __s0 = __p0; \
36352 uint32x4_t __s1 = __p1; \
36353 uint32x4_t __s2 = __p2; \
36354 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
36355 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
36356 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 3, 2, 1, 0); \
36357 __ret = (uint32x4_t) __builtin_neon_vsm3tt2aq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, __p3, 50); \
36358 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
36359 __ret; \
37756#define vcmla_rot90_laneq_f16(__p0_238, __p1_238, __p2_238, __p3_238) __extension__ ({ \
37757 float16x4_t __ret_238; \
37758 float16x4_t __s0_238 = __p0_238; \
37759 float16x4_t __s1_238 = __p1_238; \
37760 float16x8_t __s2_238 = __p2_238; \
37761 float16x4_t __rev0_238; __rev0_238 = __builtin_shufflevector(__s0_238, __s0_238, 3, 2, 1, 0); \
37762 float16x4_t __rev1_238; __rev1_238 = __builtin_shufflevector(__s1_238, __s1_238, 3, 2, 1, 0); \
37763 float16x8_t __rev2_238; __rev2_238 = __builtin_shufflevector(__s2_238, __s2_238, 7, 6, 5, 4, 3, 2, 1, 0); \
37764float16x8_t __reint_238 = __rev2_238; \
37765uint32x2_t __reint1_238 = (uint32x2_t) {__noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_238, __p3_238), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_238, __p3_238)}; \
37766 __ret_238 = __noswap_vcmla_rot90_f16(__rev0_238, __rev1_238, *(float16x4_t *) &__reint1_238); \
37767 __ret_238 = __builtin_shufflevector(__ret_238, __ret_238, 3, 2, 1, 0); \
37768 __ret_238; \
3636037769})
3636137770#endif
3636237771
3636337772#ifdef __LITTLE_ENDIAN__
36364#define vsm3tt2bq_u32(__p0, __p1, __p2, __p3) __extension__ ({ \
36365 uint32x4_t __ret; \
36366 uint32x4_t __s0 = __p0; \
36367 uint32x4_t __s1 = __p1; \
36368 uint32x4_t __s2 = __p2; \
36369 __ret = (uint32x4_t) __builtin_neon_vsm3tt2bq_v((int8x16_t)__s0, (int8x16_t)__s1, (int8x16_t)__s2, __p3, 50); \
36370 __ret; \
37773#define vcmlaq_rot90_laneq_f16(__p0_239, __p1_239, __p2_239, __p3_239) __extension__ ({ \
37774 float16x8_t __ret_239; \
37775 float16x8_t __s0_239 = __p0_239; \
37776 float16x8_t __s1_239 = __p1_239; \
37777 float16x8_t __s2_239 = __p2_239; \
37778float16x8_t __reint_239 = __s2_239; \
37779uint32x4_t __reint1_239 = (uint32x4_t) {vgetq_lane_u32(*(uint32x4_t *) &__reint_239, __p3_239), vgetq_lane_u32(*(uint32x4_t *) &__reint_239, __p3_239), vgetq_lane_u32(*(uint32x4_t *) &__reint_239, __p3_239), vgetq_lane_u32(*(uint32x4_t *) &__reint_239, __p3_239)}; \
37780 __ret_239 = vcmlaq_rot90_f16(__s0_239, __s1_239, *(float16x8_t *) &__reint1_239); \
37781 __ret_239; \
3637137782})
3637237783#else
36373#define vsm3tt2bq_u32(__p0, __p1, __p2, __p3) __extension__ ({ \
36374 uint32x4_t __ret; \
36375 uint32x4_t __s0 = __p0; \
36376 uint32x4_t __s1 = __p1; \
36377 uint32x4_t __s2 = __p2; \
36378 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
36379 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
36380 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 3, 2, 1, 0); \
36381 __ret = (uint32x4_t) __builtin_neon_vsm3tt2bq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, __p3, 50); \
36382 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
36383 __ret; \
37784#define vcmlaq_rot90_laneq_f16(__p0_240, __p1_240, __p2_240, __p3_240) __extension__ ({ \
37785 float16x8_t __ret_240; \
37786 float16x8_t __s0_240 = __p0_240; \
37787 float16x8_t __s1_240 = __p1_240; \
37788 float16x8_t __s2_240 = __p2_240; \
37789 float16x8_t __rev0_240; __rev0_240 = __builtin_shufflevector(__s0_240, __s0_240, 7, 6, 5, 4, 3, 2, 1, 0); \
37790 float16x8_t __rev1_240; __rev1_240 = __builtin_shufflevector(__s1_240, __s1_240, 7, 6, 5, 4, 3, 2, 1, 0); \
37791 float16x8_t __rev2_240; __rev2_240 = __builtin_shufflevector(__s2_240, __s2_240, 7, 6, 5, 4, 3, 2, 1, 0); \
37792float16x8_t __reint_240 = __rev2_240; \
37793uint32x4_t __reint1_240 = (uint32x4_t) {__noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_240, __p3_240), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_240, __p3_240), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_240, __p3_240), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_240, __p3_240)}; \
37794 __ret_240 = __noswap_vcmlaq_rot90_f16(__rev0_240, __rev1_240, *(float16x8_t *) &__reint1_240); \
37795 __ret_240 = __builtin_shufflevector(__ret_240, __ret_240, 7, 6, 5, 4, 3, 2, 1, 0); \
37796 __ret_240; \
3638437797})
3638537798#endif
3638637799
36387#endif
36388#if __ARM_ARCH >= 8 && defined(__ARM_FEATURE_SM4) && defined(__aarch64__)
36389#ifdef __LITTLE_ENDIAN__
36390__ai uint32x4_t vsm4eq_u32(uint32x4_t __p0, uint32x4_t __p1) {
36391 uint32x4_t __ret;
36392 __ret = (uint32x4_t) __builtin_neon_vsm4eq_v((int8x16_t)__p0, (int8x16_t)__p1, 50);
36393 return __ret;
36394}
36395#else
36396__ai uint32x4_t vsm4eq_u32(uint32x4_t __p0, uint32x4_t __p1) {
36397 uint32x4_t __ret;
36398 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
36399 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
36400 __ret = (uint32x4_t) __builtin_neon_vsm4eq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 50);
36401 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
36402 return __ret;
36403}
36404#endif
36405
36406#ifdef __LITTLE_ENDIAN__
36407__ai uint32x4_t vsm4ekeyq_u32(uint32x4_t __p0, uint32x4_t __p1) {
36408 uint32x4_t __ret;
36409 __ret = (uint32x4_t) __builtin_neon_vsm4ekeyq_v((int8x16_t)__p0, (int8x16_t)__p1, 50);
36410 return __ret;
36411}
36412#else
36413__ai uint32x4_t vsm4ekeyq_u32(uint32x4_t __p0, uint32x4_t __p1) {
36414 uint32x4_t __ret;
36415 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
36416 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
36417 __ret = (uint32x4_t) __builtin_neon_vsm4ekeyq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 50);
36418 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
36419 return __ret;
36420}
36421#endif
36422
36423#endif
36424#if __ARM_ARCH >= 8 && defined(__aarch64__)
37800#if !defined(__aarch64__)
3642537801#ifdef __LITTLE_ENDIAN__
36426__ai int64x2_t vcvtaq_s64_f64(float64x2_t __p0) {
36427 int64x2_t __ret;
36428 __ret = (int64x2_t) __builtin_neon_vcvtaq_s64_v((int8x16_t)__p0, 35);
36429 return __ret;
36430}
37802#define vqdmulhq_lane_s32(__p0_241, __p1_241, __p2_241) __extension__ ({ \
37803 int32x4_t __ret_241; \
37804 int32x4_t __s0_241 = __p0_241; \
37805 int32x2_t __s1_241 = __p1_241; \
37806 __ret_241 = vqdmulhq_s32(__s0_241, splatq_lane_s32(__s1_241, __p2_241)); \
37807 __ret_241; \
37808})
3643137809#else
36432__ai int64x2_t vcvtaq_s64_f64(float64x2_t __p0) {
36433 int64x2_t __ret;
36434 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
36435 __ret = (int64x2_t) __builtin_neon_vcvtaq_s64_v((int8x16_t)__rev0, 35);
36436 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
36437 return __ret;
36438}
37810#define vqdmulhq_lane_s32(__p0_242, __p1_242, __p2_242) __extension__ ({ \
37811 int32x4_t __ret_242; \
37812 int32x4_t __s0_242 = __p0_242; \
37813 int32x2_t __s1_242 = __p1_242; \
37814 int32x4_t __rev0_242; __rev0_242 = __builtin_shufflevector(__s0_242, __s0_242, 3, 2, 1, 0); \
37815 int32x2_t __rev1_242; __rev1_242 = __builtin_shufflevector(__s1_242, __s1_242, 1, 0); \
37816 __ret_242 = __noswap_vqdmulhq_s32(__rev0_242, __noswap_splatq_lane_s32(__rev1_242, __p2_242)); \
37817 __ret_242 = __builtin_shufflevector(__ret_242, __ret_242, 3, 2, 1, 0); \
37818 __ret_242; \
37819})
3643937820#endif
3644037821
36441__ai int64x1_t vcvta_s64_f64(float64x1_t __p0) {
36442 int64x1_t __ret;
36443 __ret = (int64x1_t) __builtin_neon_vcvta_s64_v((int8x8_t)__p0, 3);
36444 return __ret;
36445}
3644637822#ifdef __LITTLE_ENDIAN__
36447__ai uint64x2_t vcvtaq_u64_f64(float64x2_t __p0) {
36448 uint64x2_t __ret;
36449 __ret = (uint64x2_t) __builtin_neon_vcvtaq_u64_v((int8x16_t)__p0, 51);
36450 return __ret;
36451}
37823#define vqdmulhq_lane_s16(__p0_243, __p1_243, __p2_243) __extension__ ({ \
37824 int16x8_t __ret_243; \
37825 int16x8_t __s0_243 = __p0_243; \
37826 int16x4_t __s1_243 = __p1_243; \
37827 __ret_243 = vqdmulhq_s16(__s0_243, splatq_lane_s16(__s1_243, __p2_243)); \
37828 __ret_243; \
37829})
3645237830#else
36453__ai uint64x2_t vcvtaq_u64_f64(float64x2_t __p0) {
36454 uint64x2_t __ret;
36455 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
36456 __ret = (uint64x2_t) __builtin_neon_vcvtaq_u64_v((int8x16_t)__rev0, 51);
36457 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
36458 return __ret;
36459}
37831#define vqdmulhq_lane_s16(__p0_244, __p1_244, __p2_244) __extension__ ({ \
37832 int16x8_t __ret_244; \
37833 int16x8_t __s0_244 = __p0_244; \
37834 int16x4_t __s1_244 = __p1_244; \
37835 int16x8_t __rev0_244; __rev0_244 = __builtin_shufflevector(__s0_244, __s0_244, 7, 6, 5, 4, 3, 2, 1, 0); \
37836 int16x4_t __rev1_244; __rev1_244 = __builtin_shufflevector(__s1_244, __s1_244, 3, 2, 1, 0); \
37837 __ret_244 = __noswap_vqdmulhq_s16(__rev0_244, __noswap_splatq_lane_s16(__rev1_244, __p2_244)); \
37838 __ret_244 = __builtin_shufflevector(__ret_244, __ret_244, 7, 6, 5, 4, 3, 2, 1, 0); \
37839 __ret_244; \
37840})
3646037841#endif
3646137842
36462__ai uint64x1_t vcvta_u64_f64(float64x1_t __p0) {
36463 uint64x1_t __ret;
36464 __ret = (uint64x1_t) __builtin_neon_vcvta_u64_v((int8x8_t)__p0, 19);
36465 return __ret;
36466}
3646737843#ifdef __LITTLE_ENDIAN__
36468__ai int64x2_t vcvtmq_s64_f64(float64x2_t __p0) {
36469 int64x2_t __ret;
36470 __ret = (int64x2_t) __builtin_neon_vcvtmq_s64_v((int8x16_t)__p0, 35);
36471 return __ret;
36472}
37844#define vqdmulh_lane_s32(__p0_245, __p1_245, __p2_245) __extension__ ({ \
37845 int32x2_t __ret_245; \
37846 int32x2_t __s0_245 = __p0_245; \
37847 int32x2_t __s1_245 = __p1_245; \
37848 __ret_245 = vqdmulh_s32(__s0_245, splat_lane_s32(__s1_245, __p2_245)); \
37849 __ret_245; \
37850})
3647337851#else
36474__ai int64x2_t vcvtmq_s64_f64(float64x2_t __p0) {
36475 int64x2_t __ret;
36476 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
36477 __ret = (int64x2_t) __builtin_neon_vcvtmq_s64_v((int8x16_t)__rev0, 35);
36478 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
36479 return __ret;
36480}
37852#define vqdmulh_lane_s32(__p0_246, __p1_246, __p2_246) __extension__ ({ \
37853 int32x2_t __ret_246; \
37854 int32x2_t __s0_246 = __p0_246; \
37855 int32x2_t __s1_246 = __p1_246; \
37856 int32x2_t __rev0_246; __rev0_246 = __builtin_shufflevector(__s0_246, __s0_246, 1, 0); \
37857 int32x2_t __rev1_246; __rev1_246 = __builtin_shufflevector(__s1_246, __s1_246, 1, 0); \
37858 __ret_246 = __noswap_vqdmulh_s32(__rev0_246, __noswap_splat_lane_s32(__rev1_246, __p2_246)); \
37859 __ret_246 = __builtin_shufflevector(__ret_246, __ret_246, 1, 0); \
37860 __ret_246; \
37861})
3648137862#endif
3648237863
36483__ai int64x1_t vcvtm_s64_f64(float64x1_t __p0) {
36484 int64x1_t __ret;
36485 __ret = (int64x1_t) __builtin_neon_vcvtm_s64_v((int8x8_t)__p0, 3);
36486 return __ret;
36487}
3648837864#ifdef __LITTLE_ENDIAN__
36489__ai uint64x2_t vcvtmq_u64_f64(float64x2_t __p0) {
36490 uint64x2_t __ret;
36491 __ret = (uint64x2_t) __builtin_neon_vcvtmq_u64_v((int8x16_t)__p0, 51);
36492 return __ret;
36493}
37865#define vqdmulh_lane_s16(__p0_247, __p1_247, __p2_247) __extension__ ({ \
37866 int16x4_t __ret_247; \
37867 int16x4_t __s0_247 = __p0_247; \
37868 int16x4_t __s1_247 = __p1_247; \
37869 __ret_247 = vqdmulh_s16(__s0_247, splat_lane_s16(__s1_247, __p2_247)); \
37870 __ret_247; \
37871})
3649437872#else
36495__ai uint64x2_t vcvtmq_u64_f64(float64x2_t __p0) {
36496 uint64x2_t __ret;
36497 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
36498 __ret = (uint64x2_t) __builtin_neon_vcvtmq_u64_v((int8x16_t)__rev0, 51);
36499 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
36500 return __ret;
36501}
37873#define vqdmulh_lane_s16(__p0_248, __p1_248, __p2_248) __extension__ ({ \
37874 int16x4_t __ret_248; \
37875 int16x4_t __s0_248 = __p0_248; \
37876 int16x4_t __s1_248 = __p1_248; \
37877 int16x4_t __rev0_248; __rev0_248 = __builtin_shufflevector(__s0_248, __s0_248, 3, 2, 1, 0); \
37878 int16x4_t __rev1_248; __rev1_248 = __builtin_shufflevector(__s1_248, __s1_248, 3, 2, 1, 0); \
37879 __ret_248 = __noswap_vqdmulh_s16(__rev0_248, __noswap_splat_lane_s16(__rev1_248, __p2_248)); \
37880 __ret_248 = __builtin_shufflevector(__ret_248, __ret_248, 3, 2, 1, 0); \
37881 __ret_248; \
37882})
3650237883#endif
3650337884
36504__ai uint64x1_t vcvtm_u64_f64(float64x1_t __p0) {
36505 uint64x1_t __ret;
36506 __ret = (uint64x1_t) __builtin_neon_vcvtm_u64_v((int8x8_t)__p0, 19);
36507 return __ret;
36508}
3650937885#ifdef __LITTLE_ENDIAN__
36510__ai int64x2_t vcvtnq_s64_f64(float64x2_t __p0) {
36511 int64x2_t __ret;
36512 __ret = (int64x2_t) __builtin_neon_vcvtnq_s64_v((int8x16_t)__p0, 35);
36513 return __ret;
36514}
37886#define vqrdmulhq_lane_s32(__p0_249, __p1_249, __p2_249) __extension__ ({ \
37887 int32x4_t __ret_249; \
37888 int32x4_t __s0_249 = __p0_249; \
37889 int32x2_t __s1_249 = __p1_249; \
37890 __ret_249 = vqrdmulhq_s32(__s0_249, splatq_lane_s32(__s1_249, __p2_249)); \
37891 __ret_249; \
37892})
3651537893#else
36516__ai int64x2_t vcvtnq_s64_f64(float64x2_t __p0) {
36517 int64x2_t __ret;
36518 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
36519 __ret = (int64x2_t) __builtin_neon_vcvtnq_s64_v((int8x16_t)__rev0, 35);
36520 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
36521 return __ret;
36522}
37894#define vqrdmulhq_lane_s32(__p0_250, __p1_250, __p2_250) __extension__ ({ \
37895 int32x4_t __ret_250; \
37896 int32x4_t __s0_250 = __p0_250; \
37897 int32x2_t __s1_250 = __p1_250; \
37898 int32x4_t __rev0_250; __rev0_250 = __builtin_shufflevector(__s0_250, __s0_250, 3, 2, 1, 0); \
37899 int32x2_t __rev1_250; __rev1_250 = __builtin_shufflevector(__s1_250, __s1_250, 1, 0); \
37900 __ret_250 = __noswap_vqrdmulhq_s32(__rev0_250, __noswap_splatq_lane_s32(__rev1_250, __p2_250)); \
37901 __ret_250 = __builtin_shufflevector(__ret_250, __ret_250, 3, 2, 1, 0); \
37902 __ret_250; \
37903})
3652337904#endif
3652437905
36525__ai int64x1_t vcvtn_s64_f64(float64x1_t __p0) {
36526 int64x1_t __ret;
36527 __ret = (int64x1_t) __builtin_neon_vcvtn_s64_v((int8x8_t)__p0, 3);
36528 return __ret;
36529}
3653037906#ifdef __LITTLE_ENDIAN__
36531__ai uint64x2_t vcvtnq_u64_f64(float64x2_t __p0) {
36532 uint64x2_t __ret;
36533 __ret = (uint64x2_t) __builtin_neon_vcvtnq_u64_v((int8x16_t)__p0, 51);
36534 return __ret;
36535}
37907#define vqrdmulhq_lane_s16(__p0_251, __p1_251, __p2_251) __extension__ ({ \
37908 int16x8_t __ret_251; \
37909 int16x8_t __s0_251 = __p0_251; \
37910 int16x4_t __s1_251 = __p1_251; \
37911 __ret_251 = vqrdmulhq_s16(__s0_251, splatq_lane_s16(__s1_251, __p2_251)); \
37912 __ret_251; \
37913})
3653637914#else
36537__ai uint64x2_t vcvtnq_u64_f64(float64x2_t __p0) {
36538 uint64x2_t __ret;
36539 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
36540 __ret = (uint64x2_t) __builtin_neon_vcvtnq_u64_v((int8x16_t)__rev0, 51);
36541 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
36542 return __ret;
36543}
37915#define vqrdmulhq_lane_s16(__p0_252, __p1_252, __p2_252) __extension__ ({ \
37916 int16x8_t __ret_252; \
37917 int16x8_t __s0_252 = __p0_252; \
37918 int16x4_t __s1_252 = __p1_252; \
37919 int16x8_t __rev0_252; __rev0_252 = __builtin_shufflevector(__s0_252, __s0_252, 7, 6, 5, 4, 3, 2, 1, 0); \
37920 int16x4_t __rev1_252; __rev1_252 = __builtin_shufflevector(__s1_252, __s1_252, 3, 2, 1, 0); \
37921 __ret_252 = __noswap_vqrdmulhq_s16(__rev0_252, __noswap_splatq_lane_s16(__rev1_252, __p2_252)); \
37922 __ret_252 = __builtin_shufflevector(__ret_252, __ret_252, 7, 6, 5, 4, 3, 2, 1, 0); \
37923 __ret_252; \
37924})
3654437925#endif
3654537926
36546__ai uint64x1_t vcvtn_u64_f64(float64x1_t __p0) {
36547 uint64x1_t __ret;
36548 __ret = (uint64x1_t) __builtin_neon_vcvtn_u64_v((int8x8_t)__p0, 19);
36549 return __ret;
36550}
3655137927#ifdef __LITTLE_ENDIAN__
36552__ai int64x2_t vcvtpq_s64_f64(float64x2_t __p0) {
36553 int64x2_t __ret;
36554 __ret = (int64x2_t) __builtin_neon_vcvtpq_s64_v((int8x16_t)__p0, 35);
36555 return __ret;
36556}
37928#define vqrdmulh_lane_s32(__p0_253, __p1_253, __p2_253) __extension__ ({ \
37929 int32x2_t __ret_253; \
37930 int32x2_t __s0_253 = __p0_253; \
37931 int32x2_t __s1_253 = __p1_253; \
37932 __ret_253 = vqrdmulh_s32(__s0_253, splat_lane_s32(__s1_253, __p2_253)); \
37933 __ret_253; \
37934})
3655737935#else
36558__ai int64x2_t vcvtpq_s64_f64(float64x2_t __p0) {
36559 int64x2_t __ret;
36560 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
36561 __ret = (int64x2_t) __builtin_neon_vcvtpq_s64_v((int8x16_t)__rev0, 35);
36562 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
36563 return __ret;
36564}
37936#define vqrdmulh_lane_s32(__p0_254, __p1_254, __p2_254) __extension__ ({ \
37937 int32x2_t __ret_254; \
37938 int32x2_t __s0_254 = __p0_254; \
37939 int32x2_t __s1_254 = __p1_254; \
37940 int32x2_t __rev0_254; __rev0_254 = __builtin_shufflevector(__s0_254, __s0_254, 1, 0); \
37941 int32x2_t __rev1_254; __rev1_254 = __builtin_shufflevector(__s1_254, __s1_254, 1, 0); \
37942 __ret_254 = __noswap_vqrdmulh_s32(__rev0_254, __noswap_splat_lane_s32(__rev1_254, __p2_254)); \
37943 __ret_254 = __builtin_shufflevector(__ret_254, __ret_254, 1, 0); \
37944 __ret_254; \
37945})
3656537946#endif
3656637947
36567__ai int64x1_t vcvtp_s64_f64(float64x1_t __p0) {
36568 int64x1_t __ret;
36569 __ret = (int64x1_t) __builtin_neon_vcvtp_s64_v((int8x8_t)__p0, 3);
36570 return __ret;
36571}
3657237948#ifdef __LITTLE_ENDIAN__
36573__ai uint64x2_t vcvtpq_u64_f64(float64x2_t __p0) {
36574 uint64x2_t __ret;
36575 __ret = (uint64x2_t) __builtin_neon_vcvtpq_u64_v((int8x16_t)__p0, 51);
36576 return __ret;
36577}
37949#define vqrdmulh_lane_s16(__p0_255, __p1_255, __p2_255) __extension__ ({ \
37950 int16x4_t __ret_255; \
37951 int16x4_t __s0_255 = __p0_255; \
37952 int16x4_t __s1_255 = __p1_255; \
37953 __ret_255 = vqrdmulh_s16(__s0_255, splat_lane_s16(__s1_255, __p2_255)); \
37954 __ret_255; \
37955})
3657837956#else
36579__ai uint64x2_t vcvtpq_u64_f64(float64x2_t __p0) {
36580 uint64x2_t __ret;
36581 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
36582 __ret = (uint64x2_t) __builtin_neon_vcvtpq_u64_v((int8x16_t)__rev0, 51);
36583 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
36584 return __ret;
36585}
37957#define vqrdmulh_lane_s16(__p0_256, __p1_256, __p2_256) __extension__ ({ \
37958 int16x4_t __ret_256; \
37959 int16x4_t __s0_256 = __p0_256; \
37960 int16x4_t __s1_256 = __p1_256; \
37961 int16x4_t __rev0_256; __rev0_256 = __builtin_shufflevector(__s0_256, __s0_256, 3, 2, 1, 0); \
37962 int16x4_t __rev1_256; __rev1_256 = __builtin_shufflevector(__s1_256, __s1_256, 3, 2, 1, 0); \
37963 __ret_256 = __noswap_vqrdmulh_s16(__rev0_256, __noswap_splat_lane_s16(__rev1_256, __p2_256)); \
37964 __ret_256 = __builtin_shufflevector(__ret_256, __ret_256, 3, 2, 1, 0); \
37965 __ret_256; \
37966})
3658637967#endif
3658737968
36588__ai uint64x1_t vcvtp_u64_f64(float64x1_t __p0) {
36589 uint64x1_t __ret;
36590 __ret = (uint64x1_t) __builtin_neon_vcvtp_u64_v((int8x8_t)__p0, 19);
36591 return __ret;
36592}
36593__ai poly8x8_t vreinterpret_p8_p64(poly64x1_t __p0) {
36594 poly8x8_t __ret;
36595 __ret = (poly8x8_t)(__p0);
36596 return __ret;
36597}
3659837969__ai poly8x8_t vreinterpret_p8_p16(poly16x4_t __p0) {
3659937970 poly8x8_t __ret;
3660037971 __ret = (poly8x8_t)(__p0);
......@@ -36625,11 +37996,6 @@ __ai poly8x8_t vreinterpret_p8_s8(int8x8_t __p0) {
3662537996 __ret = (poly8x8_t)(__p0);
3662637997 return __ret;
3662737998}
36628__ai poly8x8_t vreinterpret_p8_f64(float64x1_t __p0) {
36629 poly8x8_t __ret;
36630 __ret = (poly8x8_t)(__p0);
36631 return __ret;
36632}
3663337999__ai poly8x8_t vreinterpret_p8_f32(float32x2_t __p0) {
3663438000 poly8x8_t __ret;
3663538001 __ret = (poly8x8_t)(__p0);
......@@ -36655,81 +38021,11 @@ __ai poly8x8_t vreinterpret_p8_s16(int16x4_t __p0) {
3665538021 __ret = (poly8x8_t)(__p0);
3665638022 return __ret;
3665738023}
36658__ai poly64x1_t vreinterpret_p64_p8(poly8x8_t __p0) {
36659 poly64x1_t __ret;
36660 __ret = (poly64x1_t)(__p0);
36661 return __ret;
36662}
36663__ai poly64x1_t vreinterpret_p64_p16(poly16x4_t __p0) {
36664 poly64x1_t __ret;
36665 __ret = (poly64x1_t)(__p0);
36666 return __ret;
36667}
36668__ai poly64x1_t vreinterpret_p64_u8(uint8x8_t __p0) {
36669 poly64x1_t __ret;
36670 __ret = (poly64x1_t)(__p0);
36671 return __ret;
36672}
36673__ai poly64x1_t vreinterpret_p64_u32(uint32x2_t __p0) {
36674 poly64x1_t __ret;
36675 __ret = (poly64x1_t)(__p0);
36676 return __ret;
36677}
36678__ai poly64x1_t vreinterpret_p64_u64(uint64x1_t __p0) {
36679 poly64x1_t __ret;
36680 __ret = (poly64x1_t)(__p0);
36681 return __ret;
36682}
36683__ai poly64x1_t vreinterpret_p64_u16(uint16x4_t __p0) {
36684 poly64x1_t __ret;
36685 __ret = (poly64x1_t)(__p0);
36686 return __ret;
36687}
36688__ai poly64x1_t vreinterpret_p64_s8(int8x8_t __p0) {
36689 poly64x1_t __ret;
36690 __ret = (poly64x1_t)(__p0);
36691 return __ret;
36692}
36693__ai poly64x1_t vreinterpret_p64_f64(float64x1_t __p0) {
36694 poly64x1_t __ret;
36695 __ret = (poly64x1_t)(__p0);
36696 return __ret;
36697}
36698__ai poly64x1_t vreinterpret_p64_f32(float32x2_t __p0) {
36699 poly64x1_t __ret;
36700 __ret = (poly64x1_t)(__p0);
36701 return __ret;
36702}
36703__ai poly64x1_t vreinterpret_p64_f16(float16x4_t __p0) {
36704 poly64x1_t __ret;
36705 __ret = (poly64x1_t)(__p0);
36706 return __ret;
36707}
36708__ai poly64x1_t vreinterpret_p64_s32(int32x2_t __p0) {
36709 poly64x1_t __ret;
36710 __ret = (poly64x1_t)(__p0);
36711 return __ret;
36712}
36713__ai poly64x1_t vreinterpret_p64_s64(int64x1_t __p0) {
36714 poly64x1_t __ret;
36715 __ret = (poly64x1_t)(__p0);
36716 return __ret;
36717}
36718__ai poly64x1_t vreinterpret_p64_s16(int16x4_t __p0) {
36719 poly64x1_t __ret;
36720 __ret = (poly64x1_t)(__p0);
36721 return __ret;
36722}
3672338024__ai poly16x4_t vreinterpret_p16_p8(poly8x8_t __p0) {
3672438025 poly16x4_t __ret;
3672538026 __ret = (poly16x4_t)(__p0);
3672638027 return __ret;
3672738028}
36728__ai poly16x4_t vreinterpret_p16_p64(poly64x1_t __p0) {
36729 poly16x4_t __ret;
36730 __ret = (poly16x4_t)(__p0);
36731 return __ret;
36732}
3673338029__ai poly16x4_t vreinterpret_p16_u8(uint8x8_t __p0) {
3673438030 poly16x4_t __ret;
3673538031 __ret = (poly16x4_t)(__p0);
......@@ -36755,11 +38051,6 @@ __ai poly16x4_t vreinterpret_p16_s8(int8x8_t __p0) {
3675538051 __ret = (poly16x4_t)(__p0);
3675638052 return __ret;
3675738053}
36758__ai poly16x4_t vreinterpret_p16_f64(float64x1_t __p0) {
36759 poly16x4_t __ret;
36760 __ret = (poly16x4_t)(__p0);
36761 return __ret;
36762}
3676338054__ai poly16x4_t vreinterpret_p16_f32(float32x2_t __p0) {
3676438055 poly16x4_t __ret;
3676538056 __ret = (poly16x4_t)(__p0);
......@@ -36785,16 +38076,6 @@ __ai poly16x4_t vreinterpret_p16_s16(int16x4_t __p0) {
3678538076 __ret = (poly16x4_t)(__p0);
3678638077 return __ret;
3678738078}
36788__ai poly8x16_t vreinterpretq_p8_p128(poly128_t __p0) {
36789 poly8x16_t __ret;
36790 __ret = (poly8x16_t)(__p0);
36791 return __ret;
36792}
36793__ai poly8x16_t vreinterpretq_p8_p64(poly64x2_t __p0) {
36794 poly8x16_t __ret;
36795 __ret = (poly8x16_t)(__p0);
36796 return __ret;
36797}
3679838079__ai poly8x16_t vreinterpretq_p8_p16(poly16x8_t __p0) {
3679938080 poly8x16_t __ret;
3680038081 __ret = (poly8x16_t)(__p0);
......@@ -36825,11 +38106,6 @@ __ai poly8x16_t vreinterpretq_p8_s8(int8x16_t __p0) {
3682538106 __ret = (poly8x16_t)(__p0);
3682638107 return __ret;
3682738108}
36828__ai poly8x16_t vreinterpretq_p8_f64(float64x2_t __p0) {
36829 poly8x16_t __ret;
36830 __ret = (poly8x16_t)(__p0);
36831 return __ret;
36832}
3683338109__ai poly8x16_t vreinterpretq_p8_f32(float32x4_t __p0) {
3683438110 poly8x16_t __ret;
3683538111 __ret = (poly8x16_t)(__p0);
......@@ -36855,161 +38131,11 @@ __ai poly8x16_t vreinterpretq_p8_s16(int16x8_t __p0) {
3685538131 __ret = (poly8x16_t)(__p0);
3685638132 return __ret;
3685738133}
36858__ai poly128_t vreinterpretq_p128_p8(poly8x16_t __p0) {
36859 poly128_t __ret;
36860 __ret = (poly128_t)(__p0);
36861 return __ret;
36862}
36863__ai poly128_t vreinterpretq_p128_p64(poly64x2_t __p0) {
36864 poly128_t __ret;
36865 __ret = (poly128_t)(__p0);
36866 return __ret;
36867}
36868__ai poly128_t vreinterpretq_p128_p16(poly16x8_t __p0) {
36869 poly128_t __ret;
36870 __ret = (poly128_t)(__p0);
36871 return __ret;
36872}
36873__ai poly128_t vreinterpretq_p128_u8(uint8x16_t __p0) {
36874 poly128_t __ret;
36875 __ret = (poly128_t)(__p0);
36876 return __ret;
36877}
36878__ai poly128_t vreinterpretq_p128_u32(uint32x4_t __p0) {
36879 poly128_t __ret;
36880 __ret = (poly128_t)(__p0);
36881 return __ret;
36882}
36883__ai poly128_t vreinterpretq_p128_u64(uint64x2_t __p0) {
36884 poly128_t __ret;
36885 __ret = (poly128_t)(__p0);
36886 return __ret;
36887}
36888__ai poly128_t vreinterpretq_p128_u16(uint16x8_t __p0) {
36889 poly128_t __ret;
36890 __ret = (poly128_t)(__p0);
36891 return __ret;
36892}
36893__ai poly128_t vreinterpretq_p128_s8(int8x16_t __p0) {
36894 poly128_t __ret;
36895 __ret = (poly128_t)(__p0);
36896 return __ret;
36897}
36898__ai poly128_t vreinterpretq_p128_f64(float64x2_t __p0) {
36899 poly128_t __ret;
36900 __ret = (poly128_t)(__p0);
36901 return __ret;
36902}
36903__ai poly128_t vreinterpretq_p128_f32(float32x4_t __p0) {
36904 poly128_t __ret;
36905 __ret = (poly128_t)(__p0);
36906 return __ret;
36907}
36908__ai poly128_t vreinterpretq_p128_f16(float16x8_t __p0) {
36909 poly128_t __ret;
36910 __ret = (poly128_t)(__p0);
36911 return __ret;
36912}
36913__ai poly128_t vreinterpretq_p128_s32(int32x4_t __p0) {
36914 poly128_t __ret;
36915 __ret = (poly128_t)(__p0);
36916 return __ret;
36917}
36918__ai poly128_t vreinterpretq_p128_s64(int64x2_t __p0) {
36919 poly128_t __ret;
36920 __ret = (poly128_t)(__p0);
36921 return __ret;
36922}
36923__ai poly128_t vreinterpretq_p128_s16(int16x8_t __p0) {
36924 poly128_t __ret;
36925 __ret = (poly128_t)(__p0);
36926 return __ret;
36927}
36928__ai poly64x2_t vreinterpretq_p64_p8(poly8x16_t __p0) {
36929 poly64x2_t __ret;
36930 __ret = (poly64x2_t)(__p0);
36931 return __ret;
36932}
36933__ai poly64x2_t vreinterpretq_p64_p128(poly128_t __p0) {
36934 poly64x2_t __ret;
36935 __ret = (poly64x2_t)(__p0);
36936 return __ret;
36937}
36938__ai poly64x2_t vreinterpretq_p64_p16(poly16x8_t __p0) {
36939 poly64x2_t __ret;
36940 __ret = (poly64x2_t)(__p0);
36941 return __ret;
36942}
36943__ai poly64x2_t vreinterpretq_p64_u8(uint8x16_t __p0) {
36944 poly64x2_t __ret;
36945 __ret = (poly64x2_t)(__p0);
36946 return __ret;
36947}
36948__ai poly64x2_t vreinterpretq_p64_u32(uint32x4_t __p0) {
36949 poly64x2_t __ret;
36950 __ret = (poly64x2_t)(__p0);
36951 return __ret;
36952}
36953__ai poly64x2_t vreinterpretq_p64_u64(uint64x2_t __p0) {
36954 poly64x2_t __ret;
36955 __ret = (poly64x2_t)(__p0);
36956 return __ret;
36957}
36958__ai poly64x2_t vreinterpretq_p64_u16(uint16x8_t __p0) {
36959 poly64x2_t __ret;
36960 __ret = (poly64x2_t)(__p0);
36961 return __ret;
36962}
36963__ai poly64x2_t vreinterpretq_p64_s8(int8x16_t __p0) {
36964 poly64x2_t __ret;
36965 __ret = (poly64x2_t)(__p0);
36966 return __ret;
36967}
36968__ai poly64x2_t vreinterpretq_p64_f64(float64x2_t __p0) {
36969 poly64x2_t __ret;
36970 __ret = (poly64x2_t)(__p0);
36971 return __ret;
36972}
36973__ai poly64x2_t vreinterpretq_p64_f32(float32x4_t __p0) {
36974 poly64x2_t __ret;
36975 __ret = (poly64x2_t)(__p0);
36976 return __ret;
36977}
36978__ai poly64x2_t vreinterpretq_p64_f16(float16x8_t __p0) {
36979 poly64x2_t __ret;
36980 __ret = (poly64x2_t)(__p0);
36981 return __ret;
36982}
36983__ai poly64x2_t vreinterpretq_p64_s32(int32x4_t __p0) {
36984 poly64x2_t __ret;
36985 __ret = (poly64x2_t)(__p0);
36986 return __ret;
36987}
36988__ai poly64x2_t vreinterpretq_p64_s64(int64x2_t __p0) {
36989 poly64x2_t __ret;
36990 __ret = (poly64x2_t)(__p0);
36991 return __ret;
36992}
36993__ai poly64x2_t vreinterpretq_p64_s16(int16x8_t __p0) {
36994 poly64x2_t __ret;
36995 __ret = (poly64x2_t)(__p0);
36996 return __ret;
36997}
3699838134__ai poly16x8_t vreinterpretq_p16_p8(poly8x16_t __p0) {
3699938135 poly16x8_t __ret;
3700038136 __ret = (poly16x8_t)(__p0);
3700138137 return __ret;
3700238138}
37003__ai poly16x8_t vreinterpretq_p16_p128(poly128_t __p0) {
37004 poly16x8_t __ret;
37005 __ret = (poly16x8_t)(__p0);
37006 return __ret;
37007}
37008__ai poly16x8_t vreinterpretq_p16_p64(poly64x2_t __p0) {
37009 poly16x8_t __ret;
37010 __ret = (poly16x8_t)(__p0);
37011 return __ret;
37012}
3701338139__ai poly16x8_t vreinterpretq_p16_u8(uint8x16_t __p0) {
3701438140 poly16x8_t __ret;
3701538141 __ret = (poly16x8_t)(__p0);
......@@ -37035,11 +38161,6 @@ __ai poly16x8_t vreinterpretq_p16_s8(int8x16_t __p0) {
3703538161 __ret = (poly16x8_t)(__p0);
3703638162 return __ret;
3703738163}
37038__ai poly16x8_t vreinterpretq_p16_f64(float64x2_t __p0) {
37039 poly16x8_t __ret;
37040 __ret = (poly16x8_t)(__p0);
37041 return __ret;
37042}
3704338164__ai poly16x8_t vreinterpretq_p16_f32(float32x4_t __p0) {
3704438165 poly16x8_t __ret;
3704538166 __ret = (poly16x8_t)(__p0);
......@@ -37070,16 +38191,6 @@ __ai uint8x16_t vreinterpretq_u8_p8(poly8x16_t __p0) {
3707038191 __ret = (uint8x16_t)(__p0);
3707138192 return __ret;
3707238193}
37073__ai uint8x16_t vreinterpretq_u8_p128(poly128_t __p0) {
37074 uint8x16_t __ret;
37075 __ret = (uint8x16_t)(__p0);
37076 return __ret;
37077}
37078__ai uint8x16_t vreinterpretq_u8_p64(poly64x2_t __p0) {
37079 uint8x16_t __ret;
37080 __ret = (uint8x16_t)(__p0);
37081 return __ret;
37082}
3708338194__ai uint8x16_t vreinterpretq_u8_p16(poly16x8_t __p0) {
3708438195 uint8x16_t __ret;
3708538196 __ret = (uint8x16_t)(__p0);
......@@ -37105,11 +38216,6 @@ __ai uint8x16_t vreinterpretq_u8_s8(int8x16_t __p0) {
3710538216 __ret = (uint8x16_t)(__p0);
3710638217 return __ret;
3710738218}
37108__ai uint8x16_t vreinterpretq_u8_f64(float64x2_t __p0) {
37109 uint8x16_t __ret;
37110 __ret = (uint8x16_t)(__p0);
37111 return __ret;
37112}
3711338219__ai uint8x16_t vreinterpretq_u8_f32(float32x4_t __p0) {
3711438220 uint8x16_t __ret;
3711538221 __ret = (uint8x16_t)(__p0);
......@@ -37140,16 +38246,6 @@ __ai uint32x4_t vreinterpretq_u32_p8(poly8x16_t __p0) {
3714038246 __ret = (uint32x4_t)(__p0);
3714138247 return __ret;
3714238248}
37143__ai uint32x4_t vreinterpretq_u32_p128(poly128_t __p0) {
37144 uint32x4_t __ret;
37145 __ret = (uint32x4_t)(__p0);
37146 return __ret;
37147}
37148__ai uint32x4_t vreinterpretq_u32_p64(poly64x2_t __p0) {
37149 uint32x4_t __ret;
37150 __ret = (uint32x4_t)(__p0);
37151 return __ret;
37152}
3715338249__ai uint32x4_t vreinterpretq_u32_p16(poly16x8_t __p0) {
3715438250 uint32x4_t __ret;
3715538251 __ret = (uint32x4_t)(__p0);
......@@ -37175,11 +38271,6 @@ __ai uint32x4_t vreinterpretq_u32_s8(int8x16_t __p0) {
3717538271 __ret = (uint32x4_t)(__p0);
3717638272 return __ret;
3717738273}
37178__ai uint32x4_t vreinterpretq_u32_f64(float64x2_t __p0) {
37179 uint32x4_t __ret;
37180 __ret = (uint32x4_t)(__p0);
37181 return __ret;
37182}
3718338274__ai uint32x4_t vreinterpretq_u32_f32(float32x4_t __p0) {
3718438275 uint32x4_t __ret;
3718538276 __ret = (uint32x4_t)(__p0);
......@@ -37210,16 +38301,6 @@ __ai uint64x2_t vreinterpretq_u64_p8(poly8x16_t __p0) {
3721038301 __ret = (uint64x2_t)(__p0);
3721138302 return __ret;
3721238303}
37213__ai uint64x2_t vreinterpretq_u64_p128(poly128_t __p0) {
37214 uint64x2_t __ret;
37215 __ret = (uint64x2_t)(__p0);
37216 return __ret;
37217}
37218__ai uint64x2_t vreinterpretq_u64_p64(poly64x2_t __p0) {
37219 uint64x2_t __ret;
37220 __ret = (uint64x2_t)(__p0);
37221 return __ret;
37222}
3722338304__ai uint64x2_t vreinterpretq_u64_p16(poly16x8_t __p0) {
3722438305 uint64x2_t __ret;
3722538306 __ret = (uint64x2_t)(__p0);
......@@ -37245,11 +38326,6 @@ __ai uint64x2_t vreinterpretq_u64_s8(int8x16_t __p0) {
3724538326 __ret = (uint64x2_t)(__p0);
3724638327 return __ret;
3724738328}
37248__ai uint64x2_t vreinterpretq_u64_f64(float64x2_t __p0) {
37249 uint64x2_t __ret;
37250 __ret = (uint64x2_t)(__p0);
37251 return __ret;
37252}
3725338329__ai uint64x2_t vreinterpretq_u64_f32(float32x4_t __p0) {
3725438330 uint64x2_t __ret;
3725538331 __ret = (uint64x2_t)(__p0);
......@@ -37280,16 +38356,6 @@ __ai uint16x8_t vreinterpretq_u16_p8(poly8x16_t __p0) {
3728038356 __ret = (uint16x8_t)(__p0);
3728138357 return __ret;
3728238358}
37283__ai uint16x8_t vreinterpretq_u16_p128(poly128_t __p0) {
37284 uint16x8_t __ret;
37285 __ret = (uint16x8_t)(__p0);
37286 return __ret;
37287}
37288__ai uint16x8_t vreinterpretq_u16_p64(poly64x2_t __p0) {
37289 uint16x8_t __ret;
37290 __ret = (uint16x8_t)(__p0);
37291 return __ret;
37292}
3729338359__ai uint16x8_t vreinterpretq_u16_p16(poly16x8_t __p0) {
3729438360 uint16x8_t __ret;
3729538361 __ret = (uint16x8_t)(__p0);
......@@ -37315,11 +38381,6 @@ __ai uint16x8_t vreinterpretq_u16_s8(int8x16_t __p0) {
3731538381 __ret = (uint16x8_t)(__p0);
3731638382 return __ret;
3731738383}
37318__ai uint16x8_t vreinterpretq_u16_f64(float64x2_t __p0) {
37319 uint16x8_t __ret;
37320 __ret = (uint16x8_t)(__p0);
37321 return __ret;
37322}
3732338384__ai uint16x8_t vreinterpretq_u16_f32(float32x4_t __p0) {
3732438385 uint16x8_t __ret;
3732538386 __ret = (uint16x8_t)(__p0);
......@@ -37350,16 +38411,6 @@ __ai int8x16_t vreinterpretq_s8_p8(poly8x16_t __p0) {
3735038411 __ret = (int8x16_t)(__p0);
3735138412 return __ret;
3735238413}
37353__ai int8x16_t vreinterpretq_s8_p128(poly128_t __p0) {
37354 int8x16_t __ret;
37355 __ret = (int8x16_t)(__p0);
37356 return __ret;
37357}
37358__ai int8x16_t vreinterpretq_s8_p64(poly64x2_t __p0) {
37359 int8x16_t __ret;
37360 __ret = (int8x16_t)(__p0);
37361 return __ret;
37362}
3736338414__ai int8x16_t vreinterpretq_s8_p16(poly16x8_t __p0) {
3736438415 int8x16_t __ret;
3736538416 __ret = (int8x16_t)(__p0);
......@@ -37385,11 +38436,6 @@ __ai int8x16_t vreinterpretq_s8_u16(uint16x8_t __p0) {
3738538436 __ret = (int8x16_t)(__p0);
3738638437 return __ret;
3738738438}
37388__ai int8x16_t vreinterpretq_s8_f64(float64x2_t __p0) {
37389 int8x16_t __ret;
37390 __ret = (int8x16_t)(__p0);
37391 return __ret;
37392}
3739338439__ai int8x16_t vreinterpretq_s8_f32(float32x4_t __p0) {
3739438440 int8x16_t __ret;
3739538441 __ret = (int8x16_t)(__p0);
......@@ -37399,103 +38445,23 @@ __ai int8x16_t vreinterpretq_s8_f16(float16x8_t __p0) {
3739938445 int8x16_t __ret;
3740038446 __ret = (int8x16_t)(__p0);
3740138447 return __ret;
37402}
37403__ai int8x16_t vreinterpretq_s8_s32(int32x4_t __p0) {
37404 int8x16_t __ret;
37405 __ret = (int8x16_t)(__p0);
37406 return __ret;
37407}
37408__ai int8x16_t vreinterpretq_s8_s64(int64x2_t __p0) {
37409 int8x16_t __ret;
37410 __ret = (int8x16_t)(__p0);
37411 return __ret;
37412}
37413__ai int8x16_t vreinterpretq_s8_s16(int16x8_t __p0) {
37414 int8x16_t __ret;
37415 __ret = (int8x16_t)(__p0);
37416 return __ret;
37417}
37418__ai float64x2_t vreinterpretq_f64_p8(poly8x16_t __p0) {
37419 float64x2_t __ret;
37420 __ret = (float64x2_t)(__p0);
37421 return __ret;
37422}
37423__ai float64x2_t vreinterpretq_f64_p128(poly128_t __p0) {
37424 float64x2_t __ret;
37425 __ret = (float64x2_t)(__p0);
37426 return __ret;
37427}
37428__ai float64x2_t vreinterpretq_f64_p64(poly64x2_t __p0) {
37429 float64x2_t __ret;
37430 __ret = (float64x2_t)(__p0);
37431 return __ret;
37432}
37433__ai float64x2_t vreinterpretq_f64_p16(poly16x8_t __p0) {
37434 float64x2_t __ret;
37435 __ret = (float64x2_t)(__p0);
37436 return __ret;
37437}
37438__ai float64x2_t vreinterpretq_f64_u8(uint8x16_t __p0) {
37439 float64x2_t __ret;
37440 __ret = (float64x2_t)(__p0);
37441 return __ret;
37442}
37443__ai float64x2_t vreinterpretq_f64_u32(uint32x4_t __p0) {
37444 float64x2_t __ret;
37445 __ret = (float64x2_t)(__p0);
37446 return __ret;
37447}
37448__ai float64x2_t vreinterpretq_f64_u64(uint64x2_t __p0) {
37449 float64x2_t __ret;
37450 __ret = (float64x2_t)(__p0);
37451 return __ret;
37452}
37453__ai float64x2_t vreinterpretq_f64_u16(uint16x8_t __p0) {
37454 float64x2_t __ret;
37455 __ret = (float64x2_t)(__p0);
37456 return __ret;
37457}
37458__ai float64x2_t vreinterpretq_f64_s8(int8x16_t __p0) {
37459 float64x2_t __ret;
37460 __ret = (float64x2_t)(__p0);
37461 return __ret;
37462}
37463__ai float64x2_t vreinterpretq_f64_f32(float32x4_t __p0) {
37464 float64x2_t __ret;
37465 __ret = (float64x2_t)(__p0);
37466 return __ret;
37467}
37468__ai float64x2_t vreinterpretq_f64_f16(float16x8_t __p0) {
37469 float64x2_t __ret;
37470 __ret = (float64x2_t)(__p0);
37471 return __ret;
37472}
37473__ai float64x2_t vreinterpretq_f64_s32(int32x4_t __p0) {
37474 float64x2_t __ret;
37475 __ret = (float64x2_t)(__p0);
37476 return __ret;
37477}
37478__ai float64x2_t vreinterpretq_f64_s64(int64x2_t __p0) {
37479 float64x2_t __ret;
37480 __ret = (float64x2_t)(__p0);
37481 return __ret;
37482}
37483__ai float64x2_t vreinterpretq_f64_s16(int16x8_t __p0) {
37484 float64x2_t __ret;
37485 __ret = (float64x2_t)(__p0);
38448}
38449__ai int8x16_t vreinterpretq_s8_s32(int32x4_t __p0) {
38450 int8x16_t __ret;
38451 __ret = (int8x16_t)(__p0);
3748638452 return __ret;
3748738453}
37488__ai float32x4_t vreinterpretq_f32_p8(poly8x16_t __p0) {
37489 float32x4_t __ret;
37490 __ret = (float32x4_t)(__p0);
38454__ai int8x16_t vreinterpretq_s8_s64(int64x2_t __p0) {
38455 int8x16_t __ret;
38456 __ret = (int8x16_t)(__p0);
3749138457 return __ret;
3749238458}
37493__ai float32x4_t vreinterpretq_f32_p128(poly128_t __p0) {
37494 float32x4_t __ret;
37495 __ret = (float32x4_t)(__p0);
38459__ai int8x16_t vreinterpretq_s8_s16(int16x8_t __p0) {
38460 int8x16_t __ret;
38461 __ret = (int8x16_t)(__p0);
3749638462 return __ret;
3749738463}
37498__ai float32x4_t vreinterpretq_f32_p64(poly64x2_t __p0) {
38464__ai float32x4_t vreinterpretq_f32_p8(poly8x16_t __p0) {
3749938465 float32x4_t __ret;
3750038466 __ret = (float32x4_t)(__p0);
3750138467 return __ret;
......@@ -37530,11 +38496,6 @@ __ai float32x4_t vreinterpretq_f32_s8(int8x16_t __p0) {
3753038496 __ret = (float32x4_t)(__p0);
3753138497 return __ret;
3753238498}
37533__ai float32x4_t vreinterpretq_f32_f64(float64x2_t __p0) {
37534 float32x4_t __ret;
37535 __ret = (float32x4_t)(__p0);
37536 return __ret;
37537}
3753838499__ai float32x4_t vreinterpretq_f32_f16(float16x8_t __p0) {
3753938500 float32x4_t __ret;
3754038501 __ret = (float32x4_t)(__p0);
......@@ -37560,16 +38521,6 @@ __ai float16x8_t vreinterpretq_f16_p8(poly8x16_t __p0) {
3756038521 __ret = (float16x8_t)(__p0);
3756138522 return __ret;
3756238523}
37563__ai float16x8_t vreinterpretq_f16_p128(poly128_t __p0) {
37564 float16x8_t __ret;
37565 __ret = (float16x8_t)(__p0);
37566 return __ret;
37567}
37568__ai float16x8_t vreinterpretq_f16_p64(poly64x2_t __p0) {
37569 float16x8_t __ret;
37570 __ret = (float16x8_t)(__p0);
37571 return __ret;
37572}
3757338524__ai float16x8_t vreinterpretq_f16_p16(poly16x8_t __p0) {
3757438525 float16x8_t __ret;
3757538526 __ret = (float16x8_t)(__p0);
......@@ -37600,11 +38551,6 @@ __ai float16x8_t vreinterpretq_f16_s8(int8x16_t __p0) {
3760038551 __ret = (float16x8_t)(__p0);
3760138552 return __ret;
3760238553}
37603__ai float16x8_t vreinterpretq_f16_f64(float64x2_t __p0) {
37604 float16x8_t __ret;
37605 __ret = (float16x8_t)(__p0);
37606 return __ret;
37607}
3760838554__ai float16x8_t vreinterpretq_f16_f32(float32x4_t __p0) {
3760938555 float16x8_t __ret;
3761038556 __ret = (float16x8_t)(__p0);
......@@ -37630,16 +38576,6 @@ __ai int32x4_t vreinterpretq_s32_p8(poly8x16_t __p0) {
3763038576 __ret = (int32x4_t)(__p0);
3763138577 return __ret;
3763238578}
37633__ai int32x4_t vreinterpretq_s32_p128(poly128_t __p0) {
37634 int32x4_t __ret;
37635 __ret = (int32x4_t)(__p0);
37636 return __ret;
37637}
37638__ai int32x4_t vreinterpretq_s32_p64(poly64x2_t __p0) {
37639 int32x4_t __ret;
37640 __ret = (int32x4_t)(__p0);
37641 return __ret;
37642}
3764338579__ai int32x4_t vreinterpretq_s32_p16(poly16x8_t __p0) {
3764438580 int32x4_t __ret;
3764538581 __ret = (int32x4_t)(__p0);
......@@ -37670,11 +38606,6 @@ __ai int32x4_t vreinterpretq_s32_s8(int8x16_t __p0) {
3767038606 __ret = (int32x4_t)(__p0);
3767138607 return __ret;
3767238608}
37673__ai int32x4_t vreinterpretq_s32_f64(float64x2_t __p0) {
37674 int32x4_t __ret;
37675 __ret = (int32x4_t)(__p0);
37676 return __ret;
37677}
3767838609__ai int32x4_t vreinterpretq_s32_f32(float32x4_t __p0) {
3767938610 int32x4_t __ret;
3768038611 __ret = (int32x4_t)(__p0);
......@@ -37700,16 +38631,6 @@ __ai int64x2_t vreinterpretq_s64_p8(poly8x16_t __p0) {
3770038631 __ret = (int64x2_t)(__p0);
3770138632 return __ret;
3770238633}
37703__ai int64x2_t vreinterpretq_s64_p128(poly128_t __p0) {
37704 int64x2_t __ret;
37705 __ret = (int64x2_t)(__p0);
37706 return __ret;
37707}
37708__ai int64x2_t vreinterpretq_s64_p64(poly64x2_t __p0) {
37709 int64x2_t __ret;
37710 __ret = (int64x2_t)(__p0);
37711 return __ret;
37712}
3771338634__ai int64x2_t vreinterpretq_s64_p16(poly16x8_t __p0) {
3771438635 int64x2_t __ret;
3771538636 __ret = (int64x2_t)(__p0);
......@@ -37740,11 +38661,6 @@ __ai int64x2_t vreinterpretq_s64_s8(int8x16_t __p0) {
3774038661 __ret = (int64x2_t)(__p0);
3774138662 return __ret;
3774238663}
37743__ai int64x2_t vreinterpretq_s64_f64(float64x2_t __p0) {
37744 int64x2_t __ret;
37745 __ret = (int64x2_t)(__p0);
37746 return __ret;
37747}
3774838664__ai int64x2_t vreinterpretq_s64_f32(float32x4_t __p0) {
3774938665 int64x2_t __ret;
3775038666 __ret = (int64x2_t)(__p0);
......@@ -37770,16 +38686,6 @@ __ai int16x8_t vreinterpretq_s16_p8(poly8x16_t __p0) {
3777038686 __ret = (int16x8_t)(__p0);
3777138687 return __ret;
3777238688}
37773__ai int16x8_t vreinterpretq_s16_p128(poly128_t __p0) {
37774 int16x8_t __ret;
37775 __ret = (int16x8_t)(__p0);
37776 return __ret;
37777}
37778__ai int16x8_t vreinterpretq_s16_p64(poly64x2_t __p0) {
37779 int16x8_t __ret;
37780 __ret = (int16x8_t)(__p0);
37781 return __ret;
37782}
3778338689__ai int16x8_t vreinterpretq_s16_p16(poly16x8_t __p0) {
3778438690 int16x8_t __ret;
3778538691 __ret = (int16x8_t)(__p0);
......@@ -37810,11 +38716,6 @@ __ai int16x8_t vreinterpretq_s16_s8(int8x16_t __p0) {
3781038716 __ret = (int16x8_t)(__p0);
3781138717 return __ret;
3781238718}
37813__ai int16x8_t vreinterpretq_s16_f64(float64x2_t __p0) {
37814 int16x8_t __ret;
37815 __ret = (int16x8_t)(__p0);
37816 return __ret;
37817}
3781838719__ai int16x8_t vreinterpretq_s16_f32(float32x4_t __p0) {
3781938720 int16x8_t __ret;
3782038721 __ret = (int16x8_t)(__p0);
......@@ -37840,11 +38741,6 @@ __ai uint8x8_t vreinterpret_u8_p8(poly8x8_t __p0) {
3784038741 __ret = (uint8x8_t)(__p0);
3784138742 return __ret;
3784238743}
37843__ai uint8x8_t vreinterpret_u8_p64(poly64x1_t __p0) {
37844 uint8x8_t __ret;
37845 __ret = (uint8x8_t)(__p0);
37846 return __ret;
37847}
3784838744__ai uint8x8_t vreinterpret_u8_p16(poly16x4_t __p0) {
3784938745 uint8x8_t __ret;
3785038746 __ret = (uint8x8_t)(__p0);
......@@ -37870,11 +38766,6 @@ __ai uint8x8_t vreinterpret_u8_s8(int8x8_t __p0) {
3787038766 __ret = (uint8x8_t)(__p0);
3787138767 return __ret;
3787238768}
37873__ai uint8x8_t vreinterpret_u8_f64(float64x1_t __p0) {
37874 uint8x8_t __ret;
37875 __ret = (uint8x8_t)(__p0);
37876 return __ret;
37877}
3787838769__ai uint8x8_t vreinterpret_u8_f32(float32x2_t __p0) {
3787938770 uint8x8_t __ret;
3788038771 __ret = (uint8x8_t)(__p0);
......@@ -37905,11 +38796,6 @@ __ai uint32x2_t vreinterpret_u32_p8(poly8x8_t __p0) {
3790538796 __ret = (uint32x2_t)(__p0);
3790638797 return __ret;
3790738798}
37908__ai uint32x2_t vreinterpret_u32_p64(poly64x1_t __p0) {
37909 uint32x2_t __ret;
37910 __ret = (uint32x2_t)(__p0);
37911 return __ret;
37912}
3791338799__ai uint32x2_t vreinterpret_u32_p16(poly16x4_t __p0) {
3791438800 uint32x2_t __ret;
3791538801 __ret = (uint32x2_t)(__p0);
......@@ -37935,11 +38821,6 @@ __ai uint32x2_t vreinterpret_u32_s8(int8x8_t __p0) {
3793538821 __ret = (uint32x2_t)(__p0);
3793638822 return __ret;
3793738823}
37938__ai uint32x2_t vreinterpret_u32_f64(float64x1_t __p0) {
37939 uint32x2_t __ret;
37940 __ret = (uint32x2_t)(__p0);
37941 return __ret;
37942}
3794338824__ai uint32x2_t vreinterpret_u32_f32(float32x2_t __p0) {
3794438825 uint32x2_t __ret;
3794538826 __ret = (uint32x2_t)(__p0);
......@@ -37970,11 +38851,6 @@ __ai uint64x1_t vreinterpret_u64_p8(poly8x8_t __p0) {
3797038851 __ret = (uint64x1_t)(__p0);
3797138852 return __ret;
3797238853}
37973__ai uint64x1_t vreinterpret_u64_p64(poly64x1_t __p0) {
37974 uint64x1_t __ret;
37975 __ret = (uint64x1_t)(__p0);
37976 return __ret;
37977}
3797838854__ai uint64x1_t vreinterpret_u64_p16(poly16x4_t __p0) {
3797938855 uint64x1_t __ret;
3798038856 __ret = (uint64x1_t)(__p0);
......@@ -38000,11 +38876,6 @@ __ai uint64x1_t vreinterpret_u64_s8(int8x8_t __p0) {
3800038876 __ret = (uint64x1_t)(__p0);
3800138877 return __ret;
3800238878}
38003__ai uint64x1_t vreinterpret_u64_f64(float64x1_t __p0) {
38004 uint64x1_t __ret;
38005 __ret = (uint64x1_t)(__p0);
38006 return __ret;
38007}
3800838879__ai uint64x1_t vreinterpret_u64_f32(float32x2_t __p0) {
3800938880 uint64x1_t __ret;
3801038881 __ret = (uint64x1_t)(__p0);
......@@ -38035,11 +38906,6 @@ __ai uint16x4_t vreinterpret_u16_p8(poly8x8_t __p0) {
3803538906 __ret = (uint16x4_t)(__p0);
3803638907 return __ret;
3803738908}
38038__ai uint16x4_t vreinterpret_u16_p64(poly64x1_t __p0) {
38039 uint16x4_t __ret;
38040 __ret = (uint16x4_t)(__p0);
38041 return __ret;
38042}
3804338909__ai uint16x4_t vreinterpret_u16_p16(poly16x4_t __p0) {
3804438910 uint16x4_t __ret;
3804538911 __ret = (uint16x4_t)(__p0);
......@@ -38065,11 +38931,6 @@ __ai uint16x4_t vreinterpret_u16_s8(int8x8_t __p0) {
3806538931 __ret = (uint16x4_t)(__p0);
3806638932 return __ret;
3806738933}
38068__ai uint16x4_t vreinterpret_u16_f64(float64x1_t __p0) {
38069 uint16x4_t __ret;
38070 __ret = (uint16x4_t)(__p0);
38071 return __ret;
38072}
3807338934__ai uint16x4_t vreinterpret_u16_f32(float32x2_t __p0) {
3807438935 uint16x4_t __ret;
3807538936 __ret = (uint16x4_t)(__p0);
......@@ -38100,11 +38961,6 @@ __ai int8x8_t vreinterpret_s8_p8(poly8x8_t __p0) {
3810038961 __ret = (int8x8_t)(__p0);
3810138962 return __ret;
3810238963}
38103__ai int8x8_t vreinterpret_s8_p64(poly64x1_t __p0) {
38104 int8x8_t __ret;
38105 __ret = (int8x8_t)(__p0);
38106 return __ret;
38107}
3810838964__ai int8x8_t vreinterpret_s8_p16(poly16x4_t __p0) {
3810938965 int8x8_t __ret;
3811038966 __ret = (int8x8_t)(__p0);
......@@ -38130,11 +38986,6 @@ __ai int8x8_t vreinterpret_s8_u16(uint16x4_t __p0) {
3813038986 __ret = (int8x8_t)(__p0);
3813138987 return __ret;
3813238988}
38133__ai int8x8_t vreinterpret_s8_f64(float64x1_t __p0) {
38134 int8x8_t __ret;
38135 __ret = (int8x8_t)(__p0);
38136 return __ret;
38137}
3813838989__ai int8x8_t vreinterpret_s8_f32(float32x2_t __p0) {
3813938990 int8x8_t __ret;
3814038991 __ret = (int8x8_t)(__p0);
......@@ -38160,81 +39011,11 @@ __ai int8x8_t vreinterpret_s8_s16(int16x4_t __p0) {
3816039011 __ret = (int8x8_t)(__p0);
3816139012 return __ret;
3816239013}
38163__ai float64x1_t vreinterpret_f64_p8(poly8x8_t __p0) {
38164 float64x1_t __ret;
38165 __ret = (float64x1_t)(__p0);
38166 return __ret;
38167}
38168__ai float64x1_t vreinterpret_f64_p64(poly64x1_t __p0) {
38169 float64x1_t __ret;
38170 __ret = (float64x1_t)(__p0);
38171 return __ret;
38172}
38173__ai float64x1_t vreinterpret_f64_p16(poly16x4_t __p0) {
38174 float64x1_t __ret;
38175 __ret = (float64x1_t)(__p0);
38176 return __ret;
38177}
38178__ai float64x1_t vreinterpret_f64_u8(uint8x8_t __p0) {
38179 float64x1_t __ret;
38180 __ret = (float64x1_t)(__p0);
38181 return __ret;
38182}
38183__ai float64x1_t vreinterpret_f64_u32(uint32x2_t __p0) {
38184 float64x1_t __ret;
38185 __ret = (float64x1_t)(__p0);
38186 return __ret;
38187}
38188__ai float64x1_t vreinterpret_f64_u64(uint64x1_t __p0) {
38189 float64x1_t __ret;
38190 __ret = (float64x1_t)(__p0);
38191 return __ret;
38192}
38193__ai float64x1_t vreinterpret_f64_u16(uint16x4_t __p0) {
38194 float64x1_t __ret;
38195 __ret = (float64x1_t)(__p0);
38196 return __ret;
38197}
38198__ai float64x1_t vreinterpret_f64_s8(int8x8_t __p0) {
38199 float64x1_t __ret;
38200 __ret = (float64x1_t)(__p0);
38201 return __ret;
38202}
38203__ai float64x1_t vreinterpret_f64_f32(float32x2_t __p0) {
38204 float64x1_t __ret;
38205 __ret = (float64x1_t)(__p0);
38206 return __ret;
38207}
38208__ai float64x1_t vreinterpret_f64_f16(float16x4_t __p0) {
38209 float64x1_t __ret;
38210 __ret = (float64x1_t)(__p0);
38211 return __ret;
38212}
38213__ai float64x1_t vreinterpret_f64_s32(int32x2_t __p0) {
38214 float64x1_t __ret;
38215 __ret = (float64x1_t)(__p0);
38216 return __ret;
38217}
38218__ai float64x1_t vreinterpret_f64_s64(int64x1_t __p0) {
38219 float64x1_t __ret;
38220 __ret = (float64x1_t)(__p0);
38221 return __ret;
38222}
38223__ai float64x1_t vreinterpret_f64_s16(int16x4_t __p0) {
38224 float64x1_t __ret;
38225 __ret = (float64x1_t)(__p0);
38226 return __ret;
38227}
3822839014__ai float32x2_t vreinterpret_f32_p8(poly8x8_t __p0) {
3822939015 float32x2_t __ret;
3823039016 __ret = (float32x2_t)(__p0);
3823139017 return __ret;
3823239018}
38233__ai float32x2_t vreinterpret_f32_p64(poly64x1_t __p0) {
38234 float32x2_t __ret;
38235 __ret = (float32x2_t)(__p0);
38236 return __ret;
38237}
3823839019__ai float32x2_t vreinterpret_f32_p16(poly16x4_t __p0) {
3823939020 float32x2_t __ret;
3824039021 __ret = (float32x2_t)(__p0);
......@@ -38265,11 +39046,6 @@ __ai float32x2_t vreinterpret_f32_s8(int8x8_t __p0) {
3826539046 __ret = (float32x2_t)(__p0);
3826639047 return __ret;
3826739048}
38268__ai float32x2_t vreinterpret_f32_f64(float64x1_t __p0) {
38269 float32x2_t __ret;
38270 __ret = (float32x2_t)(__p0);
38271 return __ret;
38272}
3827339049__ai float32x2_t vreinterpret_f32_f16(float16x4_t __p0) {
3827439050 float32x2_t __ret;
3827539051 __ret = (float32x2_t)(__p0);
......@@ -38295,11 +39071,6 @@ __ai float16x4_t vreinterpret_f16_p8(poly8x8_t __p0) {
3829539071 __ret = (float16x4_t)(__p0);
3829639072 return __ret;
3829739073}
38298__ai float16x4_t vreinterpret_f16_p64(poly64x1_t __p0) {
38299 float16x4_t __ret;
38300 __ret = (float16x4_t)(__p0);
38301 return __ret;
38302}
3830339074__ai float16x4_t vreinterpret_f16_p16(poly16x4_t __p0) {
3830439075 float16x4_t __ret;
3830539076 __ret = (float16x4_t)(__p0);
......@@ -38325,28571 +39096,27638 @@ __ai float16x4_t vreinterpret_f16_u16(uint16x4_t __p0) {
3832539096 __ret = (float16x4_t)(__p0);
3832639097 return __ret;
3832739098}
38328__ai float16x4_t vreinterpret_f16_s8(int8x8_t __p0) {
38329 float16x4_t __ret;
38330 __ret = (float16x4_t)(__p0);
39099__ai float16x4_t vreinterpret_f16_s8(int8x8_t __p0) {
39100 float16x4_t __ret;
39101 __ret = (float16x4_t)(__p0);
39102 return __ret;
39103}
39104__ai float16x4_t vreinterpret_f16_f32(float32x2_t __p0) {
39105 float16x4_t __ret;
39106 __ret = (float16x4_t)(__p0);
39107 return __ret;
39108}
39109__ai float16x4_t vreinterpret_f16_s32(int32x2_t __p0) {
39110 float16x4_t __ret;
39111 __ret = (float16x4_t)(__p0);
39112 return __ret;
39113}
39114__ai float16x4_t vreinterpret_f16_s64(int64x1_t __p0) {
39115 float16x4_t __ret;
39116 __ret = (float16x4_t)(__p0);
39117 return __ret;
39118}
39119__ai float16x4_t vreinterpret_f16_s16(int16x4_t __p0) {
39120 float16x4_t __ret;
39121 __ret = (float16x4_t)(__p0);
39122 return __ret;
39123}
39124__ai int32x2_t vreinterpret_s32_p8(poly8x8_t __p0) {
39125 int32x2_t __ret;
39126 __ret = (int32x2_t)(__p0);
39127 return __ret;
39128}
39129__ai int32x2_t vreinterpret_s32_p16(poly16x4_t __p0) {
39130 int32x2_t __ret;
39131 __ret = (int32x2_t)(__p0);
39132 return __ret;
39133}
39134__ai int32x2_t vreinterpret_s32_u8(uint8x8_t __p0) {
39135 int32x2_t __ret;
39136 __ret = (int32x2_t)(__p0);
39137 return __ret;
39138}
39139__ai int32x2_t vreinterpret_s32_u32(uint32x2_t __p0) {
39140 int32x2_t __ret;
39141 __ret = (int32x2_t)(__p0);
39142 return __ret;
39143}
39144__ai int32x2_t vreinterpret_s32_u64(uint64x1_t __p0) {
39145 int32x2_t __ret;
39146 __ret = (int32x2_t)(__p0);
39147 return __ret;
39148}
39149__ai int32x2_t vreinterpret_s32_u16(uint16x4_t __p0) {
39150 int32x2_t __ret;
39151 __ret = (int32x2_t)(__p0);
39152 return __ret;
39153}
39154__ai int32x2_t vreinterpret_s32_s8(int8x8_t __p0) {
39155 int32x2_t __ret;
39156 __ret = (int32x2_t)(__p0);
39157 return __ret;
39158}
39159__ai int32x2_t vreinterpret_s32_f32(float32x2_t __p0) {
39160 int32x2_t __ret;
39161 __ret = (int32x2_t)(__p0);
39162 return __ret;
39163}
39164__ai int32x2_t vreinterpret_s32_f16(float16x4_t __p0) {
39165 int32x2_t __ret;
39166 __ret = (int32x2_t)(__p0);
39167 return __ret;
39168}
39169__ai int32x2_t vreinterpret_s32_s64(int64x1_t __p0) {
39170 int32x2_t __ret;
39171 __ret = (int32x2_t)(__p0);
39172 return __ret;
39173}
39174__ai int32x2_t vreinterpret_s32_s16(int16x4_t __p0) {
39175 int32x2_t __ret;
39176 __ret = (int32x2_t)(__p0);
39177 return __ret;
39178}
39179__ai int64x1_t vreinterpret_s64_p8(poly8x8_t __p0) {
39180 int64x1_t __ret;
39181 __ret = (int64x1_t)(__p0);
39182 return __ret;
39183}
39184__ai int64x1_t vreinterpret_s64_p16(poly16x4_t __p0) {
39185 int64x1_t __ret;
39186 __ret = (int64x1_t)(__p0);
39187 return __ret;
39188}
39189__ai int64x1_t vreinterpret_s64_u8(uint8x8_t __p0) {
39190 int64x1_t __ret;
39191 __ret = (int64x1_t)(__p0);
39192 return __ret;
39193}
39194__ai int64x1_t vreinterpret_s64_u32(uint32x2_t __p0) {
39195 int64x1_t __ret;
39196 __ret = (int64x1_t)(__p0);
39197 return __ret;
39198}
39199__ai int64x1_t vreinterpret_s64_u64(uint64x1_t __p0) {
39200 int64x1_t __ret;
39201 __ret = (int64x1_t)(__p0);
39202 return __ret;
39203}
39204__ai int64x1_t vreinterpret_s64_u16(uint16x4_t __p0) {
39205 int64x1_t __ret;
39206 __ret = (int64x1_t)(__p0);
39207 return __ret;
39208}
39209__ai int64x1_t vreinterpret_s64_s8(int8x8_t __p0) {
39210 int64x1_t __ret;
39211 __ret = (int64x1_t)(__p0);
39212 return __ret;
39213}
39214__ai int64x1_t vreinterpret_s64_f32(float32x2_t __p0) {
39215 int64x1_t __ret;
39216 __ret = (int64x1_t)(__p0);
39217 return __ret;
39218}
39219__ai int64x1_t vreinterpret_s64_f16(float16x4_t __p0) {
39220 int64x1_t __ret;
39221 __ret = (int64x1_t)(__p0);
39222 return __ret;
39223}
39224__ai int64x1_t vreinterpret_s64_s32(int32x2_t __p0) {
39225 int64x1_t __ret;
39226 __ret = (int64x1_t)(__p0);
39227 return __ret;
39228}
39229__ai int64x1_t vreinterpret_s64_s16(int16x4_t __p0) {
39230 int64x1_t __ret;
39231 __ret = (int64x1_t)(__p0);
39232 return __ret;
39233}
39234__ai int16x4_t vreinterpret_s16_p8(poly8x8_t __p0) {
39235 int16x4_t __ret;
39236 __ret = (int16x4_t)(__p0);
39237 return __ret;
39238}
39239__ai int16x4_t vreinterpret_s16_p16(poly16x4_t __p0) {
39240 int16x4_t __ret;
39241 __ret = (int16x4_t)(__p0);
39242 return __ret;
39243}
39244__ai int16x4_t vreinterpret_s16_u8(uint8x8_t __p0) {
39245 int16x4_t __ret;
39246 __ret = (int16x4_t)(__p0);
39247 return __ret;
39248}
39249__ai int16x4_t vreinterpret_s16_u32(uint32x2_t __p0) {
39250 int16x4_t __ret;
39251 __ret = (int16x4_t)(__p0);
39252 return __ret;
39253}
39254__ai int16x4_t vreinterpret_s16_u64(uint64x1_t __p0) {
39255 int16x4_t __ret;
39256 __ret = (int16x4_t)(__p0);
39257 return __ret;
39258}
39259__ai int16x4_t vreinterpret_s16_u16(uint16x4_t __p0) {
39260 int16x4_t __ret;
39261 __ret = (int16x4_t)(__p0);
39262 return __ret;
39263}
39264__ai int16x4_t vreinterpret_s16_s8(int8x8_t __p0) {
39265 int16x4_t __ret;
39266 __ret = (int16x4_t)(__p0);
39267 return __ret;
39268}
39269__ai int16x4_t vreinterpret_s16_f32(float32x2_t __p0) {
39270 int16x4_t __ret;
39271 __ret = (int16x4_t)(__p0);
39272 return __ret;
39273}
39274__ai int16x4_t vreinterpret_s16_f16(float16x4_t __p0) {
39275 int16x4_t __ret;
39276 __ret = (int16x4_t)(__p0);
39277 return __ret;
39278}
39279__ai int16x4_t vreinterpret_s16_s32(int32x2_t __p0) {
39280 int16x4_t __ret;
39281 __ret = (int16x4_t)(__p0);
39282 return __ret;
39283}
39284__ai int16x4_t vreinterpret_s16_s64(int64x1_t __p0) {
39285 int16x4_t __ret;
39286 __ret = (int16x4_t)(__p0);
39287 return __ret;
39288}
39289#ifdef __LITTLE_ENDIAN__
39290__ai __attribute__((target("bf16"))) bfloat16x4_t __a32_vcvt_bf16_f32(float32x4_t __p0) {
39291 bfloat16x4_t __ret;
39292 __ret = (bfloat16x4_t) __builtin_neon___a32_vcvt_bf16_f32((int8x16_t)__p0, 11);
39293 return __ret;
39294}
39295#else
39296__ai __attribute__((target("bf16"))) bfloat16x4_t __a32_vcvt_bf16_f32(float32x4_t __p0) {
39297 bfloat16x4_t __ret;
39298 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
39299 __ret = (bfloat16x4_t) __builtin_neon___a32_vcvt_bf16_f32((int8x16_t)__rev0, 11);
39300 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
39301 return __ret;
39302}
39303__ai __attribute__((target("bf16"))) bfloat16x4_t __noswap___a32_vcvt_bf16_f32(float32x4_t __p0) {
39304 bfloat16x4_t __ret;
39305 __ret = (bfloat16x4_t) __builtin_neon___a32_vcvt_bf16_f32((int8x16_t)__p0, 11);
39306 return __ret;
39307}
39308#endif
39309
39310#ifdef __LITTLE_ENDIAN__
39311__ai __attribute__((target("bf16"))) bfloat16x4_t vcvt_bf16_f32(float32x4_t __p0) {
39312 bfloat16x4_t __ret;
39313 __ret = __a32_vcvt_bf16_f32(__p0);
39314 return __ret;
39315}
39316#else
39317__ai __attribute__((target("bf16"))) bfloat16x4_t vcvt_bf16_f32(float32x4_t __p0) {
39318 bfloat16x4_t __ret;
39319 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
39320 __ret = __noswap___a32_vcvt_bf16_f32(__rev0);
39321 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
39322 return __ret;
39323}
39324#endif
39325
39326#ifdef __LITTLE_ENDIAN__
39327__ai __attribute__((target("bf16"))) bfloat16x8_t vcvtq_high_bf16_f32(bfloat16x8_t __p0, float32x4_t __p1) {
39328 bfloat16x8_t __ret;
39329 __ret = vcombine_bf16(__a32_vcvt_bf16_f32(__p1), vget_low_bf16(__p0));
39330 return __ret;
39331}
39332#else
39333__ai __attribute__((target("bf16"))) bfloat16x8_t vcvtq_high_bf16_f32(bfloat16x8_t __p0, float32x4_t __p1) {
39334 bfloat16x8_t __ret;
39335 bfloat16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
39336 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
39337 __ret = __noswap_vcombine_bf16(__noswap___a32_vcvt_bf16_f32(__rev1), __noswap_vget_low_bf16(__rev0));
39338 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
39339 return __ret;
39340}
39341#endif
39342
39343#ifdef __LITTLE_ENDIAN__
39344__ai __attribute__((target("bf16"))) bfloat16x8_t vcvtq_low_bf16_f32(float32x4_t __p0) {
39345 bfloat16x8_t __ret;
39346 __ret = vcombine_bf16((bfloat16x4_t)(0ULL), __a32_vcvt_bf16_f32(__p0));
39347 return __ret;
39348}
39349#else
39350__ai __attribute__((target("bf16"))) bfloat16x8_t vcvtq_low_bf16_f32(float32x4_t __p0) {
39351 bfloat16x8_t __ret;
39352 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
39353 __ret = __noswap_vcombine_bf16((bfloat16x4_t)(0ULL), __noswap___a32_vcvt_bf16_f32(__rev0));
39354 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
39355 return __ret;
39356}
39357#endif
39358
39359__ai __attribute__((target("bf16"))) poly8x8_t vreinterpret_p8_bf16(bfloat16x4_t __p0) {
39360 poly8x8_t __ret;
39361 __ret = (poly8x8_t)(__p0);
39362 return __ret;
39363}
39364__ai __attribute__((target("bf16"))) poly64x1_t vreinterpret_p64_bf16(bfloat16x4_t __p0) {
39365 poly64x1_t __ret;
39366 __ret = (poly64x1_t)(__p0);
39367 return __ret;
39368}
39369__ai __attribute__((target("bf16"))) poly16x4_t vreinterpret_p16_bf16(bfloat16x4_t __p0) {
39370 poly16x4_t __ret;
39371 __ret = (poly16x4_t)(__p0);
39372 return __ret;
39373}
39374__ai __attribute__((target("bf16"))) poly8x16_t vreinterpretq_p8_bf16(bfloat16x8_t __p0) {
39375 poly8x16_t __ret;
39376 __ret = (poly8x16_t)(__p0);
39377 return __ret;
39378}
39379__ai __attribute__((target("bf16"))) poly64x2_t vreinterpretq_p64_bf16(bfloat16x8_t __p0) {
39380 poly64x2_t __ret;
39381 __ret = (poly64x2_t)(__p0);
39382 return __ret;
39383}
39384__ai __attribute__((target("bf16"))) poly16x8_t vreinterpretq_p16_bf16(bfloat16x8_t __p0) {
39385 poly16x8_t __ret;
39386 __ret = (poly16x8_t)(__p0);
39387 return __ret;
39388}
39389__ai __attribute__((target("bf16"))) uint8x16_t vreinterpretq_u8_bf16(bfloat16x8_t __p0) {
39390 uint8x16_t __ret;
39391 __ret = (uint8x16_t)(__p0);
39392 return __ret;
39393}
39394__ai __attribute__((target("bf16"))) uint32x4_t vreinterpretq_u32_bf16(bfloat16x8_t __p0) {
39395 uint32x4_t __ret;
39396 __ret = (uint32x4_t)(__p0);
39397 return __ret;
39398}
39399__ai __attribute__((target("bf16"))) uint64x2_t vreinterpretq_u64_bf16(bfloat16x8_t __p0) {
39400 uint64x2_t __ret;
39401 __ret = (uint64x2_t)(__p0);
39402 return __ret;
39403}
39404__ai __attribute__((target("bf16"))) uint16x8_t vreinterpretq_u16_bf16(bfloat16x8_t __p0) {
39405 uint16x8_t __ret;
39406 __ret = (uint16x8_t)(__p0);
39407 return __ret;
39408}
39409__ai __attribute__((target("bf16"))) int8x16_t vreinterpretq_s8_bf16(bfloat16x8_t __p0) {
39410 int8x16_t __ret;
39411 __ret = (int8x16_t)(__p0);
39412 return __ret;
39413}
39414__ai __attribute__((target("bf16"))) float32x4_t vreinterpretq_f32_bf16(bfloat16x8_t __p0) {
39415 float32x4_t __ret;
39416 __ret = (float32x4_t)(__p0);
39417 return __ret;
39418}
39419__ai __attribute__((target("bf16"))) float16x8_t vreinterpretq_f16_bf16(bfloat16x8_t __p0) {
39420 float16x8_t __ret;
39421 __ret = (float16x8_t)(__p0);
39422 return __ret;
39423}
39424__ai __attribute__((target("bf16"))) int32x4_t vreinterpretq_s32_bf16(bfloat16x8_t __p0) {
39425 int32x4_t __ret;
39426 __ret = (int32x4_t)(__p0);
3833139427 return __ret;
3833239428}
38333__ai float16x4_t vreinterpret_f16_f64(float64x1_t __p0) {
38334 float16x4_t __ret;
38335 __ret = (float16x4_t)(__p0);
39429__ai __attribute__((target("bf16"))) int64x2_t vreinterpretq_s64_bf16(bfloat16x8_t __p0) {
39430 int64x2_t __ret;
39431 __ret = (int64x2_t)(__p0);
3833639432 return __ret;
3833739433}
38338__ai float16x4_t vreinterpret_f16_f32(float32x2_t __p0) {
38339 float16x4_t __ret;
38340 __ret = (float16x4_t)(__p0);
39434__ai __attribute__((target("bf16"))) int16x8_t vreinterpretq_s16_bf16(bfloat16x8_t __p0) {
39435 int16x8_t __ret;
39436 __ret = (int16x8_t)(__p0);
3834139437 return __ret;
3834239438}
38343__ai float16x4_t vreinterpret_f16_s32(int32x2_t __p0) {
38344 float16x4_t __ret;
38345 __ret = (float16x4_t)(__p0);
39439__ai __attribute__((target("bf16"))) uint8x8_t vreinterpret_u8_bf16(bfloat16x4_t __p0) {
39440 uint8x8_t __ret;
39441 __ret = (uint8x8_t)(__p0);
3834639442 return __ret;
3834739443}
38348__ai float16x4_t vreinterpret_f16_s64(int64x1_t __p0) {
38349 float16x4_t __ret;
38350 __ret = (float16x4_t)(__p0);
39444__ai __attribute__((target("bf16"))) uint32x2_t vreinterpret_u32_bf16(bfloat16x4_t __p0) {
39445 uint32x2_t __ret;
39446 __ret = (uint32x2_t)(__p0);
3835139447 return __ret;
3835239448}
38353__ai float16x4_t vreinterpret_f16_s16(int16x4_t __p0) {
38354 float16x4_t __ret;
38355 __ret = (float16x4_t)(__p0);
39449__ai __attribute__((target("bf16"))) uint64x1_t vreinterpret_u64_bf16(bfloat16x4_t __p0) {
39450 uint64x1_t __ret;
39451 __ret = (uint64x1_t)(__p0);
3835639452 return __ret;
3835739453}
38358__ai int32x2_t vreinterpret_s32_p8(poly8x8_t __p0) {
38359 int32x2_t __ret;
38360 __ret = (int32x2_t)(__p0);
39454__ai __attribute__((target("bf16"))) uint16x4_t vreinterpret_u16_bf16(bfloat16x4_t __p0) {
39455 uint16x4_t __ret;
39456 __ret = (uint16x4_t)(__p0);
3836139457 return __ret;
3836239458}
38363__ai int32x2_t vreinterpret_s32_p64(poly64x1_t __p0) {
38364 int32x2_t __ret;
38365 __ret = (int32x2_t)(__p0);
39459__ai __attribute__((target("bf16"))) int8x8_t vreinterpret_s8_bf16(bfloat16x4_t __p0) {
39460 int8x8_t __ret;
39461 __ret = (int8x8_t)(__p0);
3836639462 return __ret;
3836739463}
38368__ai int32x2_t vreinterpret_s32_p16(poly16x4_t __p0) {
38369 int32x2_t __ret;
38370 __ret = (int32x2_t)(__p0);
39464__ai __attribute__((target("bf16"))) float32x2_t vreinterpret_f32_bf16(bfloat16x4_t __p0) {
39465 float32x2_t __ret;
39466 __ret = (float32x2_t)(__p0);
3837139467 return __ret;
3837239468}
38373__ai int32x2_t vreinterpret_s32_u8(uint8x8_t __p0) {
38374 int32x2_t __ret;
38375 __ret = (int32x2_t)(__p0);
39469__ai __attribute__((target("bf16"))) float16x4_t vreinterpret_f16_bf16(bfloat16x4_t __p0) {
39470 float16x4_t __ret;
39471 __ret = (float16x4_t)(__p0);
3837639472 return __ret;
3837739473}
38378__ai int32x2_t vreinterpret_s32_u32(uint32x2_t __p0) {
39474__ai __attribute__((target("bf16"))) int32x2_t vreinterpret_s32_bf16(bfloat16x4_t __p0) {
3837939475 int32x2_t __ret;
3838039476 __ret = (int32x2_t)(__p0);
3838139477 return __ret;
3838239478}
38383__ai int32x2_t vreinterpret_s32_u64(uint64x1_t __p0) {
38384 int32x2_t __ret;
38385 __ret = (int32x2_t)(__p0);
39479__ai __attribute__((target("bf16"))) int64x1_t vreinterpret_s64_bf16(bfloat16x4_t __p0) {
39480 int64x1_t __ret;
39481 __ret = (int64x1_t)(__p0);
3838639482 return __ret;
3838739483}
38388__ai int32x2_t vreinterpret_s32_u16(uint16x4_t __p0) {
38389 int32x2_t __ret;
38390 __ret = (int32x2_t)(__p0);
39484__ai __attribute__((target("bf16"))) int16x4_t vreinterpret_s16_bf16(bfloat16x4_t __p0) {
39485 int16x4_t __ret;
39486 __ret = (int16x4_t)(__p0);
3839139487 return __ret;
3839239488}
38393__ai int32x2_t vreinterpret_s32_s8(int8x8_t __p0) {
38394 int32x2_t __ret;
38395 __ret = (int32x2_t)(__p0);
39489__ai __attribute__((target("bf16"))) bfloat16x8_t vreinterpretq_bf16_p8(poly8x16_t __p0) {
39490 bfloat16x8_t __ret;
39491 __ret = (bfloat16x8_t)(__p0);
3839639492 return __ret;
3839739493}
38398__ai int32x2_t vreinterpret_s32_f64(float64x1_t __p0) {
38399 int32x2_t __ret;
38400 __ret = (int32x2_t)(__p0);
39494__ai __attribute__((target("bf16"))) bfloat16x8_t vreinterpretq_bf16_p64(poly64x2_t __p0) {
39495 bfloat16x8_t __ret;
39496 __ret = (bfloat16x8_t)(__p0);
3840139497 return __ret;
3840239498}
38403__ai int32x2_t vreinterpret_s32_f32(float32x2_t __p0) {
38404 int32x2_t __ret;
38405 __ret = (int32x2_t)(__p0);
39499__ai __attribute__((target("bf16"))) bfloat16x8_t vreinterpretq_bf16_p16(poly16x8_t __p0) {
39500 bfloat16x8_t __ret;
39501 __ret = (bfloat16x8_t)(__p0);
3840639502 return __ret;
3840739503}
38408__ai int32x2_t vreinterpret_s32_f16(float16x4_t __p0) {
38409 int32x2_t __ret;
38410 __ret = (int32x2_t)(__p0);
39504__ai __attribute__((target("bf16"))) bfloat16x8_t vreinterpretq_bf16_u8(uint8x16_t __p0) {
39505 bfloat16x8_t __ret;
39506 __ret = (bfloat16x8_t)(__p0);
3841139507 return __ret;
3841239508}
38413__ai int32x2_t vreinterpret_s32_s64(int64x1_t __p0) {
38414 int32x2_t __ret;
38415 __ret = (int32x2_t)(__p0);
39509__ai __attribute__((target("bf16"))) bfloat16x8_t vreinterpretq_bf16_u32(uint32x4_t __p0) {
39510 bfloat16x8_t __ret;
39511 __ret = (bfloat16x8_t)(__p0);
3841639512 return __ret;
3841739513}
38418__ai int32x2_t vreinterpret_s32_s16(int16x4_t __p0) {
38419 int32x2_t __ret;
38420 __ret = (int32x2_t)(__p0);
39514__ai __attribute__((target("bf16"))) bfloat16x8_t vreinterpretq_bf16_u64(uint64x2_t __p0) {
39515 bfloat16x8_t __ret;
39516 __ret = (bfloat16x8_t)(__p0);
3842139517 return __ret;
3842239518}
38423__ai int64x1_t vreinterpret_s64_p8(poly8x8_t __p0) {
38424 int64x1_t __ret;
38425 __ret = (int64x1_t)(__p0);
39519__ai __attribute__((target("bf16"))) bfloat16x8_t vreinterpretq_bf16_u16(uint16x8_t __p0) {
39520 bfloat16x8_t __ret;
39521 __ret = (bfloat16x8_t)(__p0);
3842639522 return __ret;
3842739523}
38428__ai int64x1_t vreinterpret_s64_p64(poly64x1_t __p0) {
38429 int64x1_t __ret;
38430 __ret = (int64x1_t)(__p0);
39524__ai __attribute__((target("bf16"))) bfloat16x8_t vreinterpretq_bf16_s8(int8x16_t __p0) {
39525 bfloat16x8_t __ret;
39526 __ret = (bfloat16x8_t)(__p0);
3843139527 return __ret;
3843239528}
38433__ai int64x1_t vreinterpret_s64_p16(poly16x4_t __p0) {
38434 int64x1_t __ret;
38435 __ret = (int64x1_t)(__p0);
39529__ai __attribute__((target("bf16"))) bfloat16x8_t vreinterpretq_bf16_f32(float32x4_t __p0) {
39530 bfloat16x8_t __ret;
39531 __ret = (bfloat16x8_t)(__p0);
3843639532 return __ret;
3843739533}
38438__ai int64x1_t vreinterpret_s64_u8(uint8x8_t __p0) {
38439 int64x1_t __ret;
38440 __ret = (int64x1_t)(__p0);
39534__ai __attribute__((target("bf16"))) bfloat16x8_t vreinterpretq_bf16_f16(float16x8_t __p0) {
39535 bfloat16x8_t __ret;
39536 __ret = (bfloat16x8_t)(__p0);
3844139537 return __ret;
3844239538}
38443__ai int64x1_t vreinterpret_s64_u32(uint32x2_t __p0) {
38444 int64x1_t __ret;
38445 __ret = (int64x1_t)(__p0);
39539__ai __attribute__((target("bf16"))) bfloat16x8_t vreinterpretq_bf16_s32(int32x4_t __p0) {
39540 bfloat16x8_t __ret;
39541 __ret = (bfloat16x8_t)(__p0);
3844639542 return __ret;
3844739543}
38448__ai int64x1_t vreinterpret_s64_u64(uint64x1_t __p0) {
38449 int64x1_t __ret;
38450 __ret = (int64x1_t)(__p0);
39544__ai __attribute__((target("bf16"))) bfloat16x8_t vreinterpretq_bf16_s64(int64x2_t __p0) {
39545 bfloat16x8_t __ret;
39546 __ret = (bfloat16x8_t)(__p0);
3845139547 return __ret;
3845239548}
38453__ai int64x1_t vreinterpret_s64_u16(uint16x4_t __p0) {
38454 int64x1_t __ret;
38455 __ret = (int64x1_t)(__p0);
39549__ai __attribute__((target("bf16"))) bfloat16x8_t vreinterpretq_bf16_s16(int16x8_t __p0) {
39550 bfloat16x8_t __ret;
39551 __ret = (bfloat16x8_t)(__p0);
3845639552 return __ret;
3845739553}
38458__ai int64x1_t vreinterpret_s64_s8(int8x8_t __p0) {
38459 int64x1_t __ret;
38460 __ret = (int64x1_t)(__p0);
39554__ai __attribute__((target("bf16"))) bfloat16x4_t vreinterpret_bf16_p8(poly8x8_t __p0) {
39555 bfloat16x4_t __ret;
39556 __ret = (bfloat16x4_t)(__p0);
3846139557 return __ret;
3846239558}
38463__ai int64x1_t vreinterpret_s64_f64(float64x1_t __p0) {
38464 int64x1_t __ret;
38465 __ret = (int64x1_t)(__p0);
39559__ai __attribute__((target("bf16"))) bfloat16x4_t vreinterpret_bf16_p64(poly64x1_t __p0) {
39560 bfloat16x4_t __ret;
39561 __ret = (bfloat16x4_t)(__p0);
3846639562 return __ret;
3846739563}
38468__ai int64x1_t vreinterpret_s64_f32(float32x2_t __p0) {
38469 int64x1_t __ret;
38470 __ret = (int64x1_t)(__p0);
39564__ai __attribute__((target("bf16"))) bfloat16x4_t vreinterpret_bf16_p16(poly16x4_t __p0) {
39565 bfloat16x4_t __ret;
39566 __ret = (bfloat16x4_t)(__p0);
3847139567 return __ret;
3847239568}
38473__ai int64x1_t vreinterpret_s64_f16(float16x4_t __p0) {
38474 int64x1_t __ret;
38475 __ret = (int64x1_t)(__p0);
39569__ai __attribute__((target("bf16"))) bfloat16x4_t vreinterpret_bf16_u8(uint8x8_t __p0) {
39570 bfloat16x4_t __ret;
39571 __ret = (bfloat16x4_t)(__p0);
3847639572 return __ret;
3847739573}
38478__ai int64x1_t vreinterpret_s64_s32(int32x2_t __p0) {
38479 int64x1_t __ret;
38480 __ret = (int64x1_t)(__p0);
39574__ai __attribute__((target("bf16"))) bfloat16x4_t vreinterpret_bf16_u32(uint32x2_t __p0) {
39575 bfloat16x4_t __ret;
39576 __ret = (bfloat16x4_t)(__p0);
3848139577 return __ret;
3848239578}
38483__ai int64x1_t vreinterpret_s64_s16(int16x4_t __p0) {
38484 int64x1_t __ret;
38485 __ret = (int64x1_t)(__p0);
39579__ai __attribute__((target("bf16"))) bfloat16x4_t vreinterpret_bf16_u64(uint64x1_t __p0) {
39580 bfloat16x4_t __ret;
39581 __ret = (bfloat16x4_t)(__p0);
3848639582 return __ret;
3848739583}
38488__ai int16x4_t vreinterpret_s16_p8(poly8x8_t __p0) {
38489 int16x4_t __ret;
38490 __ret = (int16x4_t)(__p0);
39584__ai __attribute__((target("bf16"))) bfloat16x4_t vreinterpret_bf16_u16(uint16x4_t __p0) {
39585 bfloat16x4_t __ret;
39586 __ret = (bfloat16x4_t)(__p0);
3849139587 return __ret;
3849239588}
38493__ai int16x4_t vreinterpret_s16_p64(poly64x1_t __p0) {
38494 int16x4_t __ret;
38495 __ret = (int16x4_t)(__p0);
39589__ai __attribute__((target("bf16"))) bfloat16x4_t vreinterpret_bf16_s8(int8x8_t __p0) {
39590 bfloat16x4_t __ret;
39591 __ret = (bfloat16x4_t)(__p0);
3849639592 return __ret;
3849739593}
38498__ai int16x4_t vreinterpret_s16_p16(poly16x4_t __p0) {
38499 int16x4_t __ret;
38500 __ret = (int16x4_t)(__p0);
39594__ai __attribute__((target("bf16"))) bfloat16x4_t vreinterpret_bf16_f32(float32x2_t __p0) {
39595 bfloat16x4_t __ret;
39596 __ret = (bfloat16x4_t)(__p0);
3850139597 return __ret;
3850239598}
38503__ai int16x4_t vreinterpret_s16_u8(uint8x8_t __p0) {
38504 int16x4_t __ret;
38505 __ret = (int16x4_t)(__p0);
39599__ai __attribute__((target("bf16"))) bfloat16x4_t vreinterpret_bf16_f16(float16x4_t __p0) {
39600 bfloat16x4_t __ret;
39601 __ret = (bfloat16x4_t)(__p0);
3850639602 return __ret;
3850739603}
38508__ai int16x4_t vreinterpret_s16_u32(uint32x2_t __p0) {
38509 int16x4_t __ret;
38510 __ret = (int16x4_t)(__p0);
39604__ai __attribute__((target("bf16"))) bfloat16x4_t vreinterpret_bf16_s32(int32x2_t __p0) {
39605 bfloat16x4_t __ret;
39606 __ret = (bfloat16x4_t)(__p0);
3851139607 return __ret;
3851239608}
38513__ai int16x4_t vreinterpret_s16_u64(uint64x1_t __p0) {
38514 int16x4_t __ret;
38515 __ret = (int16x4_t)(__p0);
39609__ai __attribute__((target("bf16"))) bfloat16x4_t vreinterpret_bf16_s64(int64x1_t __p0) {
39610 bfloat16x4_t __ret;
39611 __ret = (bfloat16x4_t)(__p0);
3851639612 return __ret;
3851739613}
38518__ai int16x4_t vreinterpret_s16_u16(uint16x4_t __p0) {
38519 int16x4_t __ret;
38520 __ret = (int16x4_t)(__p0);
39614__ai __attribute__((target("bf16"))) bfloat16x4_t vreinterpret_bf16_s16(int16x4_t __p0) {
39615 bfloat16x4_t __ret;
39616 __ret = (bfloat16x4_t)(__p0);
3852139617 return __ret;
3852239618}
38523__ai int16x4_t vreinterpret_s16_s8(int8x8_t __p0) {
38524 int16x4_t __ret;
38525 __ret = (int16x4_t)(__p0);
39619#endif
39620#if (__ARM_FP & 2)
39621#ifdef __LITTLE_ENDIAN__
39622__ai float16x4_t vcvt_f16_f32(float32x4_t __p0) {
39623 float16x4_t __ret;
39624 __ret = (float16x4_t) __builtin_neon_vcvt_f16_f32((int8x16_t)__p0, 41);
3852639625 return __ret;
3852739626}
38528__ai int16x4_t vreinterpret_s16_f64(float64x1_t __p0) {
38529 int16x4_t __ret;
38530 __ret = (int16x4_t)(__p0);
39627#else
39628__ai float16x4_t vcvt_f16_f32(float32x4_t __p0) {
39629 float16x4_t __ret;
39630 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
39631 __ret = (float16x4_t) __builtin_neon_vcvt_f16_f32((int8x16_t)__rev0, 41);
39632 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3853139633 return __ret;
3853239634}
38533__ai int16x4_t vreinterpret_s16_f32(float32x2_t __p0) {
38534 int16x4_t __ret;
38535 __ret = (int16x4_t)(__p0);
39635__ai float16x4_t __noswap_vcvt_f16_f32(float32x4_t __p0) {
39636 float16x4_t __ret;
39637 __ret = (float16x4_t) __builtin_neon_vcvt_f16_f32((int8x16_t)__p0, 41);
3853639638 return __ret;
3853739639}
38538__ai int16x4_t vreinterpret_s16_f16(float16x4_t __p0) {
38539 int16x4_t __ret;
38540 __ret = (int16x4_t)(__p0);
39640#endif
39641
39642#ifdef __LITTLE_ENDIAN__
39643__ai float32x4_t vcvt_f32_f16(float16x4_t __p0) {
39644 float32x4_t __ret;
39645 __ret = (float32x4_t) __builtin_neon_vcvt_f32_f16((int8x8_t)__p0, 8);
3854139646 return __ret;
3854239647}
38543__ai int16x4_t vreinterpret_s16_s32(int32x2_t __p0) {
38544 int16x4_t __ret;
38545 __ret = (int16x4_t)(__p0);
39648#else
39649__ai float32x4_t vcvt_f32_f16(float16x4_t __p0) {
39650 float32x4_t __ret;
39651 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
39652 __ret = (float32x4_t) __builtin_neon_vcvt_f32_f16((int8x8_t)__rev0, 8);
39653 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3854639654 return __ret;
3854739655}
38548__ai int16x4_t vreinterpret_s16_s64(int64x1_t __p0) {
38549 int16x4_t __ret;
38550 __ret = (int16x4_t)(__p0);
39656__ai float32x4_t __noswap_vcvt_f32_f16(float16x4_t __p0) {
39657 float32x4_t __ret;
39658 __ret = (float32x4_t) __builtin_neon_vcvt_f32_f16((int8x8_t)__p0, 8);
3855139659 return __ret;
3855239660}
3855339661#endif
38554#if __ARM_ARCH >= 8 && defined(__aarch64__) && defined(__ARM_FEATURE_DIRECTED_ROUNDING)
39662
39663#ifdef __LITTLE_ENDIAN__
39664#define vld1q_f16(__p0) __extension__ ({ \
39665 float16x8_t __ret; \
39666 __ret = (float16x8_t) __builtin_neon_vld1q_v(__p0, 40); \
39667 __ret; \
39668})
39669#else
39670#define vld1q_f16(__p0) __extension__ ({ \
39671 float16x8_t __ret; \
39672 __ret = (float16x8_t) __builtin_neon_vld1q_v(__p0, 40); \
39673 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
39674 __ret; \
39675})
39676#endif
39677
39678#ifdef __LITTLE_ENDIAN__
39679#define vld1_f16(__p0) __extension__ ({ \
39680 float16x4_t __ret; \
39681 __ret = (float16x4_t) __builtin_neon_vld1_v(__p0, 8); \
39682 __ret; \
39683})
39684#else
39685#define vld1_f16(__p0) __extension__ ({ \
39686 float16x4_t __ret; \
39687 __ret = (float16x4_t) __builtin_neon_vld1_v(__p0, 8); \
39688 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
39689 __ret; \
39690})
39691#endif
39692
39693#ifdef __LITTLE_ENDIAN__
39694#define vld1q_dup_f16(__p0) __extension__ ({ \
39695 float16x8_t __ret; \
39696 __ret = (float16x8_t) __builtin_neon_vld1q_dup_v(__p0, 40); \
39697 __ret; \
39698})
39699#else
39700#define vld1q_dup_f16(__p0) __extension__ ({ \
39701 float16x8_t __ret; \
39702 __ret = (float16x8_t) __builtin_neon_vld1q_dup_v(__p0, 40); \
39703 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
39704 __ret; \
39705})
39706#endif
39707
39708#ifdef __LITTLE_ENDIAN__
39709#define vld1_dup_f16(__p0) __extension__ ({ \
39710 float16x4_t __ret; \
39711 __ret = (float16x4_t) __builtin_neon_vld1_dup_v(__p0, 8); \
39712 __ret; \
39713})
39714#else
39715#define vld1_dup_f16(__p0) __extension__ ({ \
39716 float16x4_t __ret; \
39717 __ret = (float16x4_t) __builtin_neon_vld1_dup_v(__p0, 8); \
39718 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
39719 __ret; \
39720})
39721#endif
39722
39723#ifdef __LITTLE_ENDIAN__
39724#define vld1q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
39725 float16x8_t __ret; \
39726 float16x8_t __s1 = __p1; \
39727 __ret = (float16x8_t) __builtin_neon_vld1q_lane_v(__p0, (int8x16_t)__s1, __p2, 40); \
39728 __ret; \
39729})
39730#else
39731#define vld1q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
39732 float16x8_t __ret; \
39733 float16x8_t __s1 = __p1; \
39734 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
39735 __ret = (float16x8_t) __builtin_neon_vld1q_lane_v(__p0, (int8x16_t)__rev1, __p2, 40); \
39736 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
39737 __ret; \
39738})
39739#endif
39740
39741#ifdef __LITTLE_ENDIAN__
39742#define vld1_lane_f16(__p0, __p1, __p2) __extension__ ({ \
39743 float16x4_t __ret; \
39744 float16x4_t __s1 = __p1; \
39745 __ret = (float16x4_t) __builtin_neon_vld1_lane_v(__p0, (int8x8_t)__s1, __p2, 8); \
39746 __ret; \
39747})
39748#else
39749#define vld1_lane_f16(__p0, __p1, __p2) __extension__ ({ \
39750 float16x4_t __ret; \
39751 float16x4_t __s1 = __p1; \
39752 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
39753 __ret = (float16x4_t) __builtin_neon_vld1_lane_v(__p0, (int8x8_t)__rev1, __p2, 8); \
39754 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
39755 __ret; \
39756})
39757#endif
39758
39759#ifdef __LITTLE_ENDIAN__
39760#define vld1q_f16_x2(__p0) __extension__ ({ \
39761 float16x8x2_t __ret; \
39762 __builtin_neon_vld1q_x2_v(&__ret, __p0, 40); \
39763 __ret; \
39764})
39765#else
39766#define vld1q_f16_x2(__p0) __extension__ ({ \
39767 float16x8x2_t __ret; \
39768 __builtin_neon_vld1q_x2_v(&__ret, __p0, 40); \
39769 \
39770 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
39771 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
39772 __ret; \
39773})
39774#endif
39775
39776#ifdef __LITTLE_ENDIAN__
39777#define vld1_f16_x2(__p0) __extension__ ({ \
39778 float16x4x2_t __ret; \
39779 __builtin_neon_vld1_x2_v(&__ret, __p0, 8); \
39780 __ret; \
39781})
39782#else
39783#define vld1_f16_x2(__p0) __extension__ ({ \
39784 float16x4x2_t __ret; \
39785 __builtin_neon_vld1_x2_v(&__ret, __p0, 8); \
39786 \
39787 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
39788 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
39789 __ret; \
39790})
39791#endif
39792
39793#ifdef __LITTLE_ENDIAN__
39794#define vld1q_f16_x3(__p0) __extension__ ({ \
39795 float16x8x3_t __ret; \
39796 __builtin_neon_vld1q_x3_v(&__ret, __p0, 40); \
39797 __ret; \
39798})
39799#else
39800#define vld1q_f16_x3(__p0) __extension__ ({ \
39801 float16x8x3_t __ret; \
39802 __builtin_neon_vld1q_x3_v(&__ret, __p0, 40); \
39803 \
39804 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
39805 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
39806 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
39807 __ret; \
39808})
39809#endif
39810
39811#ifdef __LITTLE_ENDIAN__
39812#define vld1_f16_x3(__p0) __extension__ ({ \
39813 float16x4x3_t __ret; \
39814 __builtin_neon_vld1_x3_v(&__ret, __p0, 8); \
39815 __ret; \
39816})
39817#else
39818#define vld1_f16_x3(__p0) __extension__ ({ \
39819 float16x4x3_t __ret; \
39820 __builtin_neon_vld1_x3_v(&__ret, __p0, 8); \
39821 \
39822 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
39823 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
39824 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
39825 __ret; \
39826})
39827#endif
39828
39829#ifdef __LITTLE_ENDIAN__
39830#define vld1q_f16_x4(__p0) __extension__ ({ \
39831 float16x8x4_t __ret; \
39832 __builtin_neon_vld1q_x4_v(&__ret, __p0, 40); \
39833 __ret; \
39834})
39835#else
39836#define vld1q_f16_x4(__p0) __extension__ ({ \
39837 float16x8x4_t __ret; \
39838 __builtin_neon_vld1q_x4_v(&__ret, __p0, 40); \
39839 \
39840 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
39841 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
39842 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
39843 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
39844 __ret; \
39845})
39846#endif
39847
39848#ifdef __LITTLE_ENDIAN__
39849#define vld1_f16_x4(__p0) __extension__ ({ \
39850 float16x4x4_t __ret; \
39851 __builtin_neon_vld1_x4_v(&__ret, __p0, 8); \
39852 __ret; \
39853})
39854#else
39855#define vld1_f16_x4(__p0) __extension__ ({ \
39856 float16x4x4_t __ret; \
39857 __builtin_neon_vld1_x4_v(&__ret, __p0, 8); \
39858 \
39859 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
39860 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
39861 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
39862 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 3, 2, 1, 0); \
39863 __ret; \
39864})
39865#endif
39866
39867#ifdef __LITTLE_ENDIAN__
39868#define vld2q_f16(__p0) __extension__ ({ \
39869 float16x8x2_t __ret; \
39870 __builtin_neon_vld2q_v(&__ret, __p0, 40); \
39871 __ret; \
39872})
39873#else
39874#define vld2q_f16(__p0) __extension__ ({ \
39875 float16x8x2_t __ret; \
39876 __builtin_neon_vld2q_v(&__ret, __p0, 40); \
39877 \
39878 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
39879 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
39880 __ret; \
39881})
39882#endif
39883
39884#ifdef __LITTLE_ENDIAN__
39885#define vld2_f16(__p0) __extension__ ({ \
39886 float16x4x2_t __ret; \
39887 __builtin_neon_vld2_v(&__ret, __p0, 8); \
39888 __ret; \
39889})
39890#else
39891#define vld2_f16(__p0) __extension__ ({ \
39892 float16x4x2_t __ret; \
39893 __builtin_neon_vld2_v(&__ret, __p0, 8); \
39894 \
39895 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
39896 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
39897 __ret; \
39898})
39899#endif
39900
39901#ifdef __LITTLE_ENDIAN__
39902#define vld2q_dup_f16(__p0) __extension__ ({ \
39903 float16x8x2_t __ret; \
39904 __builtin_neon_vld2q_dup_v(&__ret, __p0, 40); \
39905 __ret; \
39906})
39907#else
39908#define vld2q_dup_f16(__p0) __extension__ ({ \
39909 float16x8x2_t __ret; \
39910 __builtin_neon_vld2q_dup_v(&__ret, __p0, 40); \
39911 \
39912 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
39913 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
39914 __ret; \
39915})
39916#endif
39917
39918#ifdef __LITTLE_ENDIAN__
39919#define vld2_dup_f16(__p0) __extension__ ({ \
39920 float16x4x2_t __ret; \
39921 __builtin_neon_vld2_dup_v(&__ret, __p0, 8); \
39922 __ret; \
39923})
39924#else
39925#define vld2_dup_f16(__p0) __extension__ ({ \
39926 float16x4x2_t __ret; \
39927 __builtin_neon_vld2_dup_v(&__ret, __p0, 8); \
39928 \
39929 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
39930 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
39931 __ret; \
39932})
39933#endif
39934
3855539935#ifdef __LITTLE_ENDIAN__
38556__ai float64x2_t vrndq_f64(float64x2_t __p0) {
38557 float64x2_t __ret;
38558 __ret = (float64x2_t) __builtin_neon_vrndq_v((int8x16_t)__p0, 42);
38559 return __ret;
38560}
39936#define vld2q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
39937 float16x8x2_t __ret; \
39938 float16x8x2_t __s1 = __p1; \
39939 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 40); \
39940 __ret; \
39941})
3856139942#else
38562__ai float64x2_t vrndq_f64(float64x2_t __p0) {
38563 float64x2_t __ret;
38564 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
38565 __ret = (float64x2_t) __builtin_neon_vrndq_v((int8x16_t)__rev0, 42);
38566 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
38567 return __ret;
38568}
39943#define vld2q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
39944 float16x8x2_t __ret; \
39945 float16x8x2_t __s1 = __p1; \
39946 float16x8x2_t __rev1; \
39947 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
39948 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
39949 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 40); \
39950 \
39951 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
39952 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
39953 __ret; \
39954})
3856939955#endif
3857039956
38571__ai float64x1_t vrnd_f64(float64x1_t __p0) {
38572 float64x1_t __ret;
38573 __ret = (float64x1_t) __builtin_neon_vrnd_v((int8x8_t)__p0, 10);
38574 return __ret;
38575}
3857639957#ifdef __LITTLE_ENDIAN__
38577__ai float64x2_t vrndaq_f64(float64x2_t __p0) {
38578 float64x2_t __ret;
38579 __ret = (float64x2_t) __builtin_neon_vrndaq_v((int8x16_t)__p0, 42);
38580 return __ret;
38581}
39958#define vld2_lane_f16(__p0, __p1, __p2) __extension__ ({ \
39959 float16x4x2_t __ret; \
39960 float16x4x2_t __s1 = __p1; \
39961 __builtin_neon_vld2_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], __p2, 8); \
39962 __ret; \
39963})
3858239964#else
38583__ai float64x2_t vrndaq_f64(float64x2_t __p0) {
38584 float64x2_t __ret;
38585 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
38586 __ret = (float64x2_t) __builtin_neon_vrndaq_v((int8x16_t)__rev0, 42);
38587 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
38588 return __ret;
38589}
39965#define vld2_lane_f16(__p0, __p1, __p2) __extension__ ({ \
39966 float16x4x2_t __ret; \
39967 float16x4x2_t __s1 = __p1; \
39968 float16x4x2_t __rev1; \
39969 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
39970 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
39971 __builtin_neon_vld2_lane_v(&__ret, __p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], __p2, 8); \
39972 \
39973 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
39974 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
39975 __ret; \
39976})
3859039977#endif
3859139978
38592__ai float64x1_t vrnda_f64(float64x1_t __p0) {
38593 float64x1_t __ret;
38594 __ret = (float64x1_t) __builtin_neon_vrnda_v((int8x8_t)__p0, 10);
38595 return __ret;
38596}
3859739979#ifdef __LITTLE_ENDIAN__
38598__ai float64x2_t vrndiq_f64(float64x2_t __p0) {
38599 float64x2_t __ret;
38600 __ret = (float64x2_t) __builtin_neon_vrndiq_v((int8x16_t)__p0, 42);
38601 return __ret;
38602}
39980#define vld3q_f16(__p0) __extension__ ({ \
39981 float16x8x3_t __ret; \
39982 __builtin_neon_vld3q_v(&__ret, __p0, 40); \
39983 __ret; \
39984})
3860339985#else
38604__ai float64x2_t vrndiq_f64(float64x2_t __p0) {
38605 float64x2_t __ret;
38606 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
38607 __ret = (float64x2_t) __builtin_neon_vrndiq_v((int8x16_t)__rev0, 42);
38608 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
38609 return __ret;
38610}
39986#define vld3q_f16(__p0) __extension__ ({ \
39987 float16x8x3_t __ret; \
39988 __builtin_neon_vld3q_v(&__ret, __p0, 40); \
39989 \
39990 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
39991 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
39992 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
39993 __ret; \
39994})
3861139995#endif
3861239996
38613__ai float64x1_t vrndi_f64(float64x1_t __p0) {
38614 float64x1_t __ret;
38615 __ret = (float64x1_t) __builtin_neon_vrndi_v((int8x8_t)__p0, 10);
38616 return __ret;
38617}
3861839997#ifdef __LITTLE_ENDIAN__
38619__ai float64x2_t vrndmq_f64(float64x2_t __p0) {
38620 float64x2_t __ret;
38621 __ret = (float64x2_t) __builtin_neon_vrndmq_v((int8x16_t)__p0, 42);
38622 return __ret;
38623}
39998#define vld3_f16(__p0) __extension__ ({ \
39999 float16x4x3_t __ret; \
40000 __builtin_neon_vld3_v(&__ret, __p0, 8); \
40001 __ret; \
40002})
3862440003#else
38625__ai float64x2_t vrndmq_f64(float64x2_t __p0) {
38626 float64x2_t __ret;
38627 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
38628 __ret = (float64x2_t) __builtin_neon_vrndmq_v((int8x16_t)__rev0, 42);
38629 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
38630 return __ret;
38631}
40004#define vld3_f16(__p0) __extension__ ({ \
40005 float16x4x3_t __ret; \
40006 __builtin_neon_vld3_v(&__ret, __p0, 8); \
40007 \
40008 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
40009 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
40010 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
40011 __ret; \
40012})
3863240013#endif
3863340014
38634__ai float64x1_t vrndm_f64(float64x1_t __p0) {
38635 float64x1_t __ret;
38636 __ret = (float64x1_t) __builtin_neon_vrndm_v((int8x8_t)__p0, 10);
38637 return __ret;
38638}
3863940015#ifdef __LITTLE_ENDIAN__
38640__ai float64x2_t vrndnq_f64(float64x2_t __p0) {
38641 float64x2_t __ret;
38642 __ret = (float64x2_t) __builtin_neon_vrndnq_v((int8x16_t)__p0, 42);
38643 return __ret;
38644}
40016#define vld3q_dup_f16(__p0) __extension__ ({ \
40017 float16x8x3_t __ret; \
40018 __builtin_neon_vld3q_dup_v(&__ret, __p0, 40); \
40019 __ret; \
40020})
3864540021#else
38646__ai float64x2_t vrndnq_f64(float64x2_t __p0) {
38647 float64x2_t __ret;
38648 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
38649 __ret = (float64x2_t) __builtin_neon_vrndnq_v((int8x16_t)__rev0, 42);
38650 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
38651 return __ret;
38652}
40022#define vld3q_dup_f16(__p0) __extension__ ({ \
40023 float16x8x3_t __ret; \
40024 __builtin_neon_vld3q_dup_v(&__ret, __p0, 40); \
40025 \
40026 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40027 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40028 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
40029 __ret; \
40030})
40031#endif
40032
40033#ifdef __LITTLE_ENDIAN__
40034#define vld3_dup_f16(__p0) __extension__ ({ \
40035 float16x4x3_t __ret; \
40036 __builtin_neon_vld3_dup_v(&__ret, __p0, 8); \
40037 __ret; \
40038})
40039#else
40040#define vld3_dup_f16(__p0) __extension__ ({ \
40041 float16x4x3_t __ret; \
40042 __builtin_neon_vld3_dup_v(&__ret, __p0, 8); \
40043 \
40044 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
40045 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
40046 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
40047 __ret; \
40048})
40049#endif
40050
40051#ifdef __LITTLE_ENDIAN__
40052#define vld3q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
40053 float16x8x3_t __ret; \
40054 float16x8x3_t __s1 = __p1; \
40055 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 40); \
40056 __ret; \
40057})
40058#else
40059#define vld3q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
40060 float16x8x3_t __ret; \
40061 float16x8x3_t __s1 = __p1; \
40062 float16x8x3_t __rev1; \
40063 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40064 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40065 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
40066 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 40); \
40067 \
40068 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40069 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40070 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
40071 __ret; \
40072})
40073#endif
40074
40075#ifdef __LITTLE_ENDIAN__
40076#define vld3_lane_f16(__p0, __p1, __p2) __extension__ ({ \
40077 float16x4x3_t __ret; \
40078 float16x4x3_t __s1 = __p1; \
40079 __builtin_neon_vld3_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], __p2, 8); \
40080 __ret; \
40081})
40082#else
40083#define vld3_lane_f16(__p0, __p1, __p2) __extension__ ({ \
40084 float16x4x3_t __ret; \
40085 float16x4x3_t __s1 = __p1; \
40086 float16x4x3_t __rev1; \
40087 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
40088 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
40089 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
40090 __builtin_neon_vld3_lane_v(&__ret, __p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], __p2, 8); \
40091 \
40092 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
40093 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
40094 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
40095 __ret; \
40096})
40097#endif
40098
40099#ifdef __LITTLE_ENDIAN__
40100#define vld4q_f16(__p0) __extension__ ({ \
40101 float16x8x4_t __ret; \
40102 __builtin_neon_vld4q_v(&__ret, __p0, 40); \
40103 __ret; \
40104})
40105#else
40106#define vld4q_f16(__p0) __extension__ ({ \
40107 float16x8x4_t __ret; \
40108 __builtin_neon_vld4q_v(&__ret, __p0, 40); \
40109 \
40110 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40111 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40112 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
40113 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
40114 __ret; \
40115})
40116#endif
40117
40118#ifdef __LITTLE_ENDIAN__
40119#define vld4_f16(__p0) __extension__ ({ \
40120 float16x4x4_t __ret; \
40121 __builtin_neon_vld4_v(&__ret, __p0, 8); \
40122 __ret; \
40123})
40124#else
40125#define vld4_f16(__p0) __extension__ ({ \
40126 float16x4x4_t __ret; \
40127 __builtin_neon_vld4_v(&__ret, __p0, 8); \
40128 \
40129 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
40130 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
40131 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
40132 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 3, 2, 1, 0); \
40133 __ret; \
40134})
40135#endif
40136
40137#ifdef __LITTLE_ENDIAN__
40138#define vld4q_dup_f16(__p0) __extension__ ({ \
40139 float16x8x4_t __ret; \
40140 __builtin_neon_vld4q_dup_v(&__ret, __p0, 40); \
40141 __ret; \
40142})
40143#else
40144#define vld4q_dup_f16(__p0) __extension__ ({ \
40145 float16x8x4_t __ret; \
40146 __builtin_neon_vld4q_dup_v(&__ret, __p0, 40); \
40147 \
40148 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40149 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40150 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
40151 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
40152 __ret; \
40153})
40154#endif
40155
40156#ifdef __LITTLE_ENDIAN__
40157#define vld4_dup_f16(__p0) __extension__ ({ \
40158 float16x4x4_t __ret; \
40159 __builtin_neon_vld4_dup_v(&__ret, __p0, 8); \
40160 __ret; \
40161})
40162#else
40163#define vld4_dup_f16(__p0) __extension__ ({ \
40164 float16x4x4_t __ret; \
40165 __builtin_neon_vld4_dup_v(&__ret, __p0, 8); \
40166 \
40167 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
40168 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
40169 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
40170 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 3, 2, 1, 0); \
40171 __ret; \
40172})
40173#endif
40174
40175#ifdef __LITTLE_ENDIAN__
40176#define vld4q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
40177 float16x8x4_t __ret; \
40178 float16x8x4_t __s1 = __p1; \
40179 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 40); \
40180 __ret; \
40181})
40182#else
40183#define vld4q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
40184 float16x8x4_t __ret; \
40185 float16x8x4_t __s1 = __p1; \
40186 float16x8x4_t __rev1; \
40187 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40188 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40189 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
40190 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
40191 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 40); \
40192 \
40193 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40194 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40195 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
40196 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
40197 __ret; \
40198})
40199#endif
40200
40201#ifdef __LITTLE_ENDIAN__
40202#define vld4_lane_f16(__p0, __p1, __p2) __extension__ ({ \
40203 float16x4x4_t __ret; \
40204 float16x4x4_t __s1 = __p1; \
40205 __builtin_neon_vld4_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], __p2, 8); \
40206 __ret; \
40207})
40208#else
40209#define vld4_lane_f16(__p0, __p1, __p2) __extension__ ({ \
40210 float16x4x4_t __ret; \
40211 float16x4x4_t __s1 = __p1; \
40212 float16x4x4_t __rev1; \
40213 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
40214 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
40215 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
40216 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 3, 2, 1, 0); \
40217 __builtin_neon_vld4_lane_v(&__ret, __p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], (int8x8_t)__rev1.val[3], __p2, 8); \
40218 \
40219 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
40220 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
40221 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
40222 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 3, 2, 1, 0); \
40223 __ret; \
40224})
40225#endif
40226
40227#ifdef __LITTLE_ENDIAN__
40228#define vst1q_f16(__p0, __p1) __extension__ ({ \
40229 float16x8_t __s1 = __p1; \
40230 __builtin_neon_vst1q_v(__p0, (int8x16_t)__s1, 40); \
40231})
40232#else
40233#define vst1q_f16(__p0, __p1) __extension__ ({ \
40234 float16x8_t __s1 = __p1; \
40235 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
40236 __builtin_neon_vst1q_v(__p0, (int8x16_t)__rev1, 40); \
40237})
40238#endif
40239
40240#ifdef __LITTLE_ENDIAN__
40241#define vst1_f16(__p0, __p1) __extension__ ({ \
40242 float16x4_t __s1 = __p1; \
40243 __builtin_neon_vst1_v(__p0, (int8x8_t)__s1, 8); \
40244})
40245#else
40246#define vst1_f16(__p0, __p1) __extension__ ({ \
40247 float16x4_t __s1 = __p1; \
40248 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
40249 __builtin_neon_vst1_v(__p0, (int8x8_t)__rev1, 8); \
40250})
40251#endif
40252
40253#ifdef __LITTLE_ENDIAN__
40254#define vst1q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
40255 float16x8_t __s1 = __p1; \
40256 __builtin_neon_vst1q_lane_v(__p0, (int8x16_t)__s1, __p2, 40); \
40257})
40258#else
40259#define vst1q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
40260 float16x8_t __s1 = __p1; \
40261 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
40262 __builtin_neon_vst1q_lane_v(__p0, (int8x16_t)__rev1, __p2, 40); \
40263})
40264#endif
40265
40266#ifdef __LITTLE_ENDIAN__
40267#define vst1_lane_f16(__p0, __p1, __p2) __extension__ ({ \
40268 float16x4_t __s1 = __p1; \
40269 __builtin_neon_vst1_lane_v(__p0, (int8x8_t)__s1, __p2, 8); \
40270})
40271#else
40272#define vst1_lane_f16(__p0, __p1, __p2) __extension__ ({ \
40273 float16x4_t __s1 = __p1; \
40274 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
40275 __builtin_neon_vst1_lane_v(__p0, (int8x8_t)__rev1, __p2, 8); \
40276})
40277#endif
40278
40279#ifdef __LITTLE_ENDIAN__
40280#define vst1q_f16_x2(__p0, __p1) __extension__ ({ \
40281 float16x8x2_t __s1 = __p1; \
40282 __builtin_neon_vst1q_x2_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], 40); \
40283})
40284#else
40285#define vst1q_f16_x2(__p0, __p1) __extension__ ({ \
40286 float16x8x2_t __s1 = __p1; \
40287 float16x8x2_t __rev1; \
40288 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40289 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40290 __builtin_neon_vst1q_x2_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], 40); \
40291})
40292#endif
40293
40294#ifdef __LITTLE_ENDIAN__
40295#define vst1_f16_x2(__p0, __p1) __extension__ ({ \
40296 float16x4x2_t __s1 = __p1; \
40297 __builtin_neon_vst1_x2_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], 8); \
40298})
40299#else
40300#define vst1_f16_x2(__p0, __p1) __extension__ ({ \
40301 float16x4x2_t __s1 = __p1; \
40302 float16x4x2_t __rev1; \
40303 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
40304 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
40305 __builtin_neon_vst1_x2_v(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], 8); \
40306})
40307#endif
40308
40309#ifdef __LITTLE_ENDIAN__
40310#define vst1q_f16_x3(__p0, __p1) __extension__ ({ \
40311 float16x8x3_t __s1 = __p1; \
40312 __builtin_neon_vst1q_x3_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], 40); \
40313})
40314#else
40315#define vst1q_f16_x3(__p0, __p1) __extension__ ({ \
40316 float16x8x3_t __s1 = __p1; \
40317 float16x8x3_t __rev1; \
40318 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40319 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40320 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
40321 __builtin_neon_vst1q_x3_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], 40); \
40322})
40323#endif
40324
40325#ifdef __LITTLE_ENDIAN__
40326#define vst1_f16_x3(__p0, __p1) __extension__ ({ \
40327 float16x4x3_t __s1 = __p1; \
40328 __builtin_neon_vst1_x3_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], 8); \
40329})
40330#else
40331#define vst1_f16_x3(__p0, __p1) __extension__ ({ \
40332 float16x4x3_t __s1 = __p1; \
40333 float16x4x3_t __rev1; \
40334 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
40335 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
40336 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
40337 __builtin_neon_vst1_x3_v(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], 8); \
40338})
40339#endif
40340
40341#ifdef __LITTLE_ENDIAN__
40342#define vst1q_f16_x4(__p0, __p1) __extension__ ({ \
40343 float16x8x4_t __s1 = __p1; \
40344 __builtin_neon_vst1q_x4_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], 40); \
40345})
40346#else
40347#define vst1q_f16_x4(__p0, __p1) __extension__ ({ \
40348 float16x8x4_t __s1 = __p1; \
40349 float16x8x4_t __rev1; \
40350 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40351 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40352 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
40353 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
40354 __builtin_neon_vst1q_x4_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], 40); \
40355})
40356#endif
40357
40358#ifdef __LITTLE_ENDIAN__
40359#define vst1_f16_x4(__p0, __p1) __extension__ ({ \
40360 float16x4x4_t __s1 = __p1; \
40361 __builtin_neon_vst1_x4_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], 8); \
40362})
40363#else
40364#define vst1_f16_x4(__p0, __p1) __extension__ ({ \
40365 float16x4x4_t __s1 = __p1; \
40366 float16x4x4_t __rev1; \
40367 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
40368 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
40369 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
40370 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 3, 2, 1, 0); \
40371 __builtin_neon_vst1_x4_v(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], (int8x8_t)__rev1.val[3], 8); \
40372})
40373#endif
40374
40375#ifdef __LITTLE_ENDIAN__
40376#define vst2q_f16(__p0, __p1) __extension__ ({ \
40377 float16x8x2_t __s1 = __p1; \
40378 __builtin_neon_vst2q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], 40); \
40379})
40380#else
40381#define vst2q_f16(__p0, __p1) __extension__ ({ \
40382 float16x8x2_t __s1 = __p1; \
40383 float16x8x2_t __rev1; \
40384 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40385 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40386 __builtin_neon_vst2q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], 40); \
40387})
3865340388#endif
3865440389
38655__ai float64x1_t vrndn_f64(float64x1_t __p0) {
38656 float64x1_t __ret;
38657 __ret = (float64x1_t) __builtin_neon_vrndn_v((int8x8_t)__p0, 10);
38658 return __ret;
38659}
3866040390#ifdef __LITTLE_ENDIAN__
38661__ai float64x2_t vrndpq_f64(float64x2_t __p0) {
38662 float64x2_t __ret;
38663 __ret = (float64x2_t) __builtin_neon_vrndpq_v((int8x16_t)__p0, 42);
38664 return __ret;
38665}
40391#define vst2_f16(__p0, __p1) __extension__ ({ \
40392 float16x4x2_t __s1 = __p1; \
40393 __builtin_neon_vst2_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], 8); \
40394})
3866640395#else
38667__ai float64x2_t vrndpq_f64(float64x2_t __p0) {
38668 float64x2_t __ret;
38669 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
38670 __ret = (float64x2_t) __builtin_neon_vrndpq_v((int8x16_t)__rev0, 42);
38671 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
38672 return __ret;
38673}
40396#define vst2_f16(__p0, __p1) __extension__ ({ \
40397 float16x4x2_t __s1 = __p1; \
40398 float16x4x2_t __rev1; \
40399 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
40400 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
40401 __builtin_neon_vst2_v(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], 8); \
40402})
3867440403#endif
3867540404
38676__ai float64x1_t vrndp_f64(float64x1_t __p0) {
38677 float64x1_t __ret;
38678 __ret = (float64x1_t) __builtin_neon_vrndp_v((int8x8_t)__p0, 10);
38679 return __ret;
38680}
3868140405#ifdef __LITTLE_ENDIAN__
38682__ai float64x2_t vrndxq_f64(float64x2_t __p0) {
38683 float64x2_t __ret;
38684 __ret = (float64x2_t) __builtin_neon_vrndxq_v((int8x16_t)__p0, 42);
38685 return __ret;
38686}
40406#define vst2q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
40407 float16x8x2_t __s1 = __p1; \
40408 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 40); \
40409})
3868740410#else
38688__ai float64x2_t vrndxq_f64(float64x2_t __p0) {
38689 float64x2_t __ret;
38690 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
38691 __ret = (float64x2_t) __builtin_neon_vrndxq_v((int8x16_t)__rev0, 42);
38692 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
38693 return __ret;
38694}
40411#define vst2q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
40412 float16x8x2_t __s1 = __p1; \
40413 float16x8x2_t __rev1; \
40414 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40415 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40416 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 40); \
40417})
3869540418#endif
3869640419
38697__ai float64x1_t vrndx_f64(float64x1_t __p0) {
38698 float64x1_t __ret;
38699 __ret = (float64x1_t) __builtin_neon_vrndx_v((int8x8_t)__p0, 10);
38700 return __ret;
38701}
40420#ifdef __LITTLE_ENDIAN__
40421#define vst2_lane_f16(__p0, __p1, __p2) __extension__ ({ \
40422 float16x4x2_t __s1 = __p1; \
40423 __builtin_neon_vst2_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], __p2, 8); \
40424})
40425#else
40426#define vst2_lane_f16(__p0, __p1, __p2) __extension__ ({ \
40427 float16x4x2_t __s1 = __p1; \
40428 float16x4x2_t __rev1; \
40429 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
40430 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
40431 __builtin_neon_vst2_lane_v(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], __p2, 8); \
40432})
3870240433#endif
38703#if __ARM_ARCH >= 8 && defined(__aarch64__) && defined(__ARM_FEATURE_FRINT)
40434
3870440435#ifdef __LITTLE_ENDIAN__
38705__ai float32x4_t vrnd32xq_f32(float32x4_t __p0) {
38706 float32x4_t __ret;
38707 __ret = (float32x4_t) __builtin_neon_vrnd32xq_v((int8x16_t)__p0, 41);
38708 return __ret;
38709}
40436#define vst3q_f16(__p0, __p1) __extension__ ({ \
40437 float16x8x3_t __s1 = __p1; \
40438 __builtin_neon_vst3q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], 40); \
40439})
3871040440#else
38711__ai float32x4_t vrnd32xq_f32(float32x4_t __p0) {
38712 float32x4_t __ret;
38713 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
38714 __ret = (float32x4_t) __builtin_neon_vrnd32xq_v((int8x16_t)__rev0, 41);
38715 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
38716 return __ret;
38717}
40441#define vst3q_f16(__p0, __p1) __extension__ ({ \
40442 float16x8x3_t __s1 = __p1; \
40443 float16x8x3_t __rev1; \
40444 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40445 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40446 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
40447 __builtin_neon_vst3q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], 40); \
40448})
3871840449#endif
3871940450
3872040451#ifdef __LITTLE_ENDIAN__
38721__ai float32x2_t vrnd32x_f32(float32x2_t __p0) {
38722 float32x2_t __ret;
38723 __ret = (float32x2_t) __builtin_neon_vrnd32x_v((int8x8_t)__p0, 9);
38724 return __ret;
38725}
40452#define vst3_f16(__p0, __p1) __extension__ ({ \
40453 float16x4x3_t __s1 = __p1; \
40454 __builtin_neon_vst3_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], 8); \
40455})
3872640456#else
38727__ai float32x2_t vrnd32x_f32(float32x2_t __p0) {
38728 float32x2_t __ret;
38729 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
38730 __ret = (float32x2_t) __builtin_neon_vrnd32x_v((int8x8_t)__rev0, 9);
38731 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
38732 return __ret;
38733}
40457#define vst3_f16(__p0, __p1) __extension__ ({ \
40458 float16x4x3_t __s1 = __p1; \
40459 float16x4x3_t __rev1; \
40460 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
40461 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
40462 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
40463 __builtin_neon_vst3_v(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], 8); \
40464})
3873440465#endif
3873540466
3873640467#ifdef __LITTLE_ENDIAN__
38737__ai float32x4_t vrnd32zq_f32(float32x4_t __p0) {
38738 float32x4_t __ret;
38739 __ret = (float32x4_t) __builtin_neon_vrnd32zq_v((int8x16_t)__p0, 41);
38740 return __ret;
38741}
40468#define vst3q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
40469 float16x8x3_t __s1 = __p1; \
40470 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 40); \
40471})
3874240472#else
38743__ai float32x4_t vrnd32zq_f32(float32x4_t __p0) {
38744 float32x4_t __ret;
38745 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
38746 __ret = (float32x4_t) __builtin_neon_vrnd32zq_v((int8x16_t)__rev0, 41);
38747 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
38748 return __ret;
38749}
40473#define vst3q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
40474 float16x8x3_t __s1 = __p1; \
40475 float16x8x3_t __rev1; \
40476 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40477 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40478 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
40479 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 40); \
40480})
3875040481#endif
3875140482
3875240483#ifdef __LITTLE_ENDIAN__
38753__ai float32x2_t vrnd32z_f32(float32x2_t __p0) {
38754 float32x2_t __ret;
38755 __ret = (float32x2_t) __builtin_neon_vrnd32z_v((int8x8_t)__p0, 9);
38756 return __ret;
38757}
40484#define vst3_lane_f16(__p0, __p1, __p2) __extension__ ({ \
40485 float16x4x3_t __s1 = __p1; \
40486 __builtin_neon_vst3_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], __p2, 8); \
40487})
3875840488#else
38759__ai float32x2_t vrnd32z_f32(float32x2_t __p0) {
38760 float32x2_t __ret;
38761 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
38762 __ret = (float32x2_t) __builtin_neon_vrnd32z_v((int8x8_t)__rev0, 9);
38763 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
38764 return __ret;
38765}
40489#define vst3_lane_f16(__p0, __p1, __p2) __extension__ ({ \
40490 float16x4x3_t __s1 = __p1; \
40491 float16x4x3_t __rev1; \
40492 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
40493 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
40494 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
40495 __builtin_neon_vst3_lane_v(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], __p2, 8); \
40496})
3876640497#endif
3876740498
3876840499#ifdef __LITTLE_ENDIAN__
38769__ai float32x4_t vrnd64xq_f32(float32x4_t __p0) {
38770 float32x4_t __ret;
38771 __ret = (float32x4_t) __builtin_neon_vrnd64xq_v((int8x16_t)__p0, 41);
38772 return __ret;
38773}
40500#define vst4q_f16(__p0, __p1) __extension__ ({ \
40501 float16x8x4_t __s1 = __p1; \
40502 __builtin_neon_vst4q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], 40); \
40503})
3877440504#else
38775__ai float32x4_t vrnd64xq_f32(float32x4_t __p0) {
38776 float32x4_t __ret;
38777 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
38778 __ret = (float32x4_t) __builtin_neon_vrnd64xq_v((int8x16_t)__rev0, 41);
38779 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
38780 return __ret;
38781}
40505#define vst4q_f16(__p0, __p1) __extension__ ({ \
40506 float16x8x4_t __s1 = __p1; \
40507 float16x8x4_t __rev1; \
40508 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40509 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40510 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
40511 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
40512 __builtin_neon_vst4q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], 40); \
40513})
3878240514#endif
3878340515
3878440516#ifdef __LITTLE_ENDIAN__
38785__ai float32x2_t vrnd64x_f32(float32x2_t __p0) {
38786 float32x2_t __ret;
38787 __ret = (float32x2_t) __builtin_neon_vrnd64x_v((int8x8_t)__p0, 9);
38788 return __ret;
38789}
40517#define vst4_f16(__p0, __p1) __extension__ ({ \
40518 float16x4x4_t __s1 = __p1; \
40519 __builtin_neon_vst4_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], 8); \
40520})
3879040521#else
38791__ai float32x2_t vrnd64x_f32(float32x2_t __p0) {
38792 float32x2_t __ret;
38793 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
38794 __ret = (float32x2_t) __builtin_neon_vrnd64x_v((int8x8_t)__rev0, 9);
38795 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
38796 return __ret;
38797}
40522#define vst4_f16(__p0, __p1) __extension__ ({ \
40523 float16x4x4_t __s1 = __p1; \
40524 float16x4x4_t __rev1; \
40525 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
40526 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
40527 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
40528 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 3, 2, 1, 0); \
40529 __builtin_neon_vst4_v(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], (int8x8_t)__rev1.val[3], 8); \
40530})
3879840531#endif
3879940532
3880040533#ifdef __LITTLE_ENDIAN__
38801__ai float32x4_t vrnd64zq_f32(float32x4_t __p0) {
38802 float32x4_t __ret;
38803 __ret = (float32x4_t) __builtin_neon_vrnd64zq_v((int8x16_t)__p0, 41);
38804 return __ret;
38805}
40534#define vst4q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
40535 float16x8x4_t __s1 = __p1; \
40536 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 40); \
40537})
3880640538#else
38807__ai float32x4_t vrnd64zq_f32(float32x4_t __p0) {
38808 float32x4_t __ret;
38809 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
38810 __ret = (float32x4_t) __builtin_neon_vrnd64zq_v((int8x16_t)__rev0, 41);
38811 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
38812 return __ret;
38813}
40539#define vst4q_lane_f16(__p0, __p1, __p2) __extension__ ({ \
40540 float16x8x4_t __s1 = __p1; \
40541 float16x8x4_t __rev1; \
40542 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40543 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40544 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
40545 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
40546 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 40); \
40547})
3881440548#endif
3881540549
3881640550#ifdef __LITTLE_ENDIAN__
38817__ai float32x2_t vrnd64z_f32(float32x2_t __p0) {
38818 float32x2_t __ret;
38819 __ret = (float32x2_t) __builtin_neon_vrnd64z_v((int8x8_t)__p0, 9);
38820 return __ret;
38821}
40551#define vst4_lane_f16(__p0, __p1, __p2) __extension__ ({ \
40552 float16x4x4_t __s1 = __p1; \
40553 __builtin_neon_vst4_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], __p2, 8); \
40554})
3882240555#else
38823__ai float32x2_t vrnd64z_f32(float32x2_t __p0) {
38824 float32x2_t __ret;
38825 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
38826 __ret = (float32x2_t) __builtin_neon_vrnd64z_v((int8x8_t)__rev0, 9);
38827 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
38828 return __ret;
38829}
40556#define vst4_lane_f16(__p0, __p1, __p2) __extension__ ({ \
40557 float16x4x4_t __s1 = __p1; \
40558 float16x4x4_t __rev1; \
40559 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
40560 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
40561 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
40562 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 3, 2, 1, 0); \
40563 __builtin_neon_vst4_lane_v(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], (int8x8_t)__rev1.val[3], __p2, 8); \
40564})
3883040565#endif
3883140566
3883240567#endif
38833#if __ARM_ARCH >= 8 && defined(__aarch64__) && defined(__ARM_FEATURE_NUMERIC_MAXMIN)
40568#if __ARM_ARCH >= 8
3883440569#ifdef __LITTLE_ENDIAN__
38835__ai float64x2_t vmaxnmq_f64(float64x2_t __p0, float64x2_t __p1) {
38836 float64x2_t __ret;
38837 __ret = (float64x2_t) __builtin_neon_vmaxnmq_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
40570__ai int32x4_t vcvtaq_s32_f32(float32x4_t __p0) {
40571 int32x4_t __ret;
40572 __ret = (int32x4_t) __builtin_neon_vcvtaq_s32_v((int8x16_t)__p0, 34);
3883840573 return __ret;
3883940574}
3884040575#else
38841__ai float64x2_t vmaxnmq_f64(float64x2_t __p0, float64x2_t __p1) {
38842 float64x2_t __ret;
38843 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
38844 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
38845 __ret = (float64x2_t) __builtin_neon_vmaxnmq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
38846 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
40576__ai int32x4_t vcvtaq_s32_f32(float32x4_t __p0) {
40577 int32x4_t __ret;
40578 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
40579 __ret = (int32x4_t) __builtin_neon_vcvtaq_s32_v((int8x16_t)__rev0, 34);
40580 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3884740581 return __ret;
3884840582}
3884940583#endif
3885040584
38851__ai float64x1_t vmaxnm_f64(float64x1_t __p0, float64x1_t __p1) {
38852 float64x1_t __ret;
38853 __ret = (float64x1_t) __builtin_neon_vmaxnm_v((int8x8_t)__p0, (int8x8_t)__p1, 10);
38854 return __ret;
38855}
3885640585#ifdef __LITTLE_ENDIAN__
38857__ai float64x2_t vminnmq_f64(float64x2_t __p0, float64x2_t __p1) {
38858 float64x2_t __ret;
38859 __ret = (float64x2_t) __builtin_neon_vminnmq_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
40586__ai int32x2_t vcvta_s32_f32(float32x2_t __p0) {
40587 int32x2_t __ret;
40588 __ret = (int32x2_t) __builtin_neon_vcvta_s32_v((int8x8_t)__p0, 2);
3886040589 return __ret;
3886140590}
3886240591#else
38863__ai float64x2_t vminnmq_f64(float64x2_t __p0, float64x2_t __p1) {
38864 float64x2_t __ret;
38865 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
38866 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
38867 __ret = (float64x2_t) __builtin_neon_vminnmq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
40592__ai int32x2_t vcvta_s32_f32(float32x2_t __p0) {
40593 int32x2_t __ret;
40594 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
40595 __ret = (int32x2_t) __builtin_neon_vcvta_s32_v((int8x8_t)__rev0, 2);
3886840596 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
3886940597 return __ret;
3887040598}
3887140599#endif
3887240600
38873__ai float64x1_t vminnm_f64(float64x1_t __p0, float64x1_t __p1) {
38874 float64x1_t __ret;
38875 __ret = (float64x1_t) __builtin_neon_vminnm_v((int8x8_t)__p0, (int8x8_t)__p1, 10);
38876 return __ret;
38877}
38878#endif
38879#if defined(__ARM_FEATURE_BF16) && !defined(__aarch64__)
38880__ai poly8x8_t vreinterpret_p8_bf16(bfloat16x4_t __p0) {
38881 poly8x8_t __ret;
38882 __ret = (poly8x8_t)(__p0);
38883 return __ret;
38884}
38885__ai poly64x1_t vreinterpret_p64_bf16(bfloat16x4_t __p0) {
38886 poly64x1_t __ret;
38887 __ret = (poly64x1_t)(__p0);
38888 return __ret;
38889}
38890__ai poly16x4_t vreinterpret_p16_bf16(bfloat16x4_t __p0) {
38891 poly16x4_t __ret;
38892 __ret = (poly16x4_t)(__p0);
38893 return __ret;
38894}
38895__ai poly8x16_t vreinterpretq_p8_bf16(bfloat16x8_t __p0) {
38896 poly8x16_t __ret;
38897 __ret = (poly8x16_t)(__p0);
38898 return __ret;
38899}
38900__ai poly64x2_t vreinterpretq_p64_bf16(bfloat16x8_t __p0) {
38901 poly64x2_t __ret;
38902 __ret = (poly64x2_t)(__p0);
38903 return __ret;
38904}
38905__ai poly16x8_t vreinterpretq_p16_bf16(bfloat16x8_t __p0) {
38906 poly16x8_t __ret;
38907 __ret = (poly16x8_t)(__p0);
38908 return __ret;
38909}
38910__ai uint8x16_t vreinterpretq_u8_bf16(bfloat16x8_t __p0) {
38911 uint8x16_t __ret;
38912 __ret = (uint8x16_t)(__p0);
38913 return __ret;
38914}
38915__ai uint32x4_t vreinterpretq_u32_bf16(bfloat16x8_t __p0) {
40601#ifdef __LITTLE_ENDIAN__
40602__ai uint32x4_t vcvtaq_u32_f32(float32x4_t __p0) {
3891640603 uint32x4_t __ret;
38917 __ret = (uint32x4_t)(__p0);
38918 return __ret;
38919}
38920__ai uint64x2_t vreinterpretq_u64_bf16(bfloat16x8_t __p0) {
38921 uint64x2_t __ret;
38922 __ret = (uint64x2_t)(__p0);
38923 return __ret;
38924}
38925__ai uint16x8_t vreinterpretq_u16_bf16(bfloat16x8_t __p0) {
38926 uint16x8_t __ret;
38927 __ret = (uint16x8_t)(__p0);
38928 return __ret;
38929}
38930__ai int8x16_t vreinterpretq_s8_bf16(bfloat16x8_t __p0) {
38931 int8x16_t __ret;
38932 __ret = (int8x16_t)(__p0);
38933 return __ret;
38934}
38935__ai float32x4_t vreinterpretq_f32_bf16(bfloat16x8_t __p0) {
38936 float32x4_t __ret;
38937 __ret = (float32x4_t)(__p0);
38938 return __ret;
38939}
38940__ai float16x8_t vreinterpretq_f16_bf16(bfloat16x8_t __p0) {
38941 float16x8_t __ret;
38942 __ret = (float16x8_t)(__p0);
38943 return __ret;
38944}
38945__ai int32x4_t vreinterpretq_s32_bf16(bfloat16x8_t __p0) {
38946 int32x4_t __ret;
38947 __ret = (int32x4_t)(__p0);
38948 return __ret;
38949}
38950__ai int64x2_t vreinterpretq_s64_bf16(bfloat16x8_t __p0) {
38951 int64x2_t __ret;
38952 __ret = (int64x2_t)(__p0);
38953 return __ret;
38954}
38955__ai int16x8_t vreinterpretq_s16_bf16(bfloat16x8_t __p0) {
38956 int16x8_t __ret;
38957 __ret = (int16x8_t)(__p0);
38958 return __ret;
38959}
38960__ai uint8x8_t vreinterpret_u8_bf16(bfloat16x4_t __p0) {
38961 uint8x8_t __ret;
38962 __ret = (uint8x8_t)(__p0);
38963 return __ret;
38964}
38965__ai uint32x2_t vreinterpret_u32_bf16(bfloat16x4_t __p0) {
38966 uint32x2_t __ret;
38967 __ret = (uint32x2_t)(__p0);
38968 return __ret;
38969}
38970__ai uint64x1_t vreinterpret_u64_bf16(bfloat16x4_t __p0) {
38971 uint64x1_t __ret;
38972 __ret = (uint64x1_t)(__p0);
38973 return __ret;
38974}
38975__ai uint16x4_t vreinterpret_u16_bf16(bfloat16x4_t __p0) {
38976 uint16x4_t __ret;
38977 __ret = (uint16x4_t)(__p0);
38978 return __ret;
38979}
38980__ai int8x8_t vreinterpret_s8_bf16(bfloat16x4_t __p0) {
38981 int8x8_t __ret;
38982 __ret = (int8x8_t)(__p0);
38983 return __ret;
38984}
38985__ai float32x2_t vreinterpret_f32_bf16(bfloat16x4_t __p0) {
38986 float32x2_t __ret;
38987 __ret = (float32x2_t)(__p0);
38988 return __ret;
38989}
38990__ai float16x4_t vreinterpret_f16_bf16(bfloat16x4_t __p0) {
38991 float16x4_t __ret;
38992 __ret = (float16x4_t)(__p0);
38993 return __ret;
38994}
38995__ai int32x2_t vreinterpret_s32_bf16(bfloat16x4_t __p0) {
38996 int32x2_t __ret;
38997 __ret = (int32x2_t)(__p0);
38998 return __ret;
38999}
39000__ai int64x1_t vreinterpret_s64_bf16(bfloat16x4_t __p0) {
39001 int64x1_t __ret;
39002 __ret = (int64x1_t)(__p0);
39003 return __ret;
39004}
39005__ai int16x4_t vreinterpret_s16_bf16(bfloat16x4_t __p0) {
39006 int16x4_t __ret;
39007 __ret = (int16x4_t)(__p0);
39008 return __ret;
39009}
39010__ai bfloat16x8_t vreinterpretq_bf16_p8(poly8x16_t __p0) {
39011 bfloat16x8_t __ret;
39012 __ret = (bfloat16x8_t)(__p0);
39013 return __ret;
39014}
39015__ai bfloat16x8_t vreinterpretq_bf16_p64(poly64x2_t __p0) {
39016 bfloat16x8_t __ret;
39017 __ret = (bfloat16x8_t)(__p0);
39018 return __ret;
39019}
39020__ai bfloat16x8_t vreinterpretq_bf16_p16(poly16x8_t __p0) {
39021 bfloat16x8_t __ret;
39022 __ret = (bfloat16x8_t)(__p0);
39023 return __ret;
39024}
39025__ai bfloat16x8_t vreinterpretq_bf16_u8(uint8x16_t __p0) {
39026 bfloat16x8_t __ret;
39027 __ret = (bfloat16x8_t)(__p0);
39028 return __ret;
39029}
39030__ai bfloat16x8_t vreinterpretq_bf16_u32(uint32x4_t __p0) {
39031 bfloat16x8_t __ret;
39032 __ret = (bfloat16x8_t)(__p0);
39033 return __ret;
39034}
39035__ai bfloat16x8_t vreinterpretq_bf16_u64(uint64x2_t __p0) {
39036 bfloat16x8_t __ret;
39037 __ret = (bfloat16x8_t)(__p0);
39038 return __ret;
39039}
39040__ai bfloat16x8_t vreinterpretq_bf16_u16(uint16x8_t __p0) {
39041 bfloat16x8_t __ret;
39042 __ret = (bfloat16x8_t)(__p0);
39043 return __ret;
39044}
39045__ai bfloat16x8_t vreinterpretq_bf16_s8(int8x16_t __p0) {
39046 bfloat16x8_t __ret;
39047 __ret = (bfloat16x8_t)(__p0);
39048 return __ret;
39049}
39050__ai bfloat16x8_t vreinterpretq_bf16_f32(float32x4_t __p0) {
39051 bfloat16x8_t __ret;
39052 __ret = (bfloat16x8_t)(__p0);
39053 return __ret;
39054}
39055__ai bfloat16x8_t vreinterpretq_bf16_f16(float16x8_t __p0) {
39056 bfloat16x8_t __ret;
39057 __ret = (bfloat16x8_t)(__p0);
39058 return __ret;
39059}
39060__ai bfloat16x8_t vreinterpretq_bf16_s32(int32x4_t __p0) {
39061 bfloat16x8_t __ret;
39062 __ret = (bfloat16x8_t)(__p0);
39063 return __ret;
39064}
39065__ai bfloat16x8_t vreinterpretq_bf16_s64(int64x2_t __p0) {
39066 bfloat16x8_t __ret;
39067 __ret = (bfloat16x8_t)(__p0);
39068 return __ret;
39069}
39070__ai bfloat16x8_t vreinterpretq_bf16_s16(int16x8_t __p0) {
39071 bfloat16x8_t __ret;
39072 __ret = (bfloat16x8_t)(__p0);
39073 return __ret;
39074}
39075__ai bfloat16x4_t vreinterpret_bf16_p8(poly8x8_t __p0) {
39076 bfloat16x4_t __ret;
39077 __ret = (bfloat16x4_t)(__p0);
39078 return __ret;
39079}
39080__ai bfloat16x4_t vreinterpret_bf16_p64(poly64x1_t __p0) {
39081 bfloat16x4_t __ret;
39082 __ret = (bfloat16x4_t)(__p0);
39083 return __ret;
39084}
39085__ai bfloat16x4_t vreinterpret_bf16_p16(poly16x4_t __p0) {
39086 bfloat16x4_t __ret;
39087 __ret = (bfloat16x4_t)(__p0);
39088 return __ret;
39089}
39090__ai bfloat16x4_t vreinterpret_bf16_u8(uint8x8_t __p0) {
39091 bfloat16x4_t __ret;
39092 __ret = (bfloat16x4_t)(__p0);
39093 return __ret;
39094}
39095__ai bfloat16x4_t vreinterpret_bf16_u32(uint32x2_t __p0) {
39096 bfloat16x4_t __ret;
39097 __ret = (bfloat16x4_t)(__p0);
39098 return __ret;
39099}
39100__ai bfloat16x4_t vreinterpret_bf16_u64(uint64x1_t __p0) {
39101 bfloat16x4_t __ret;
39102 __ret = (bfloat16x4_t)(__p0);
39103 return __ret;
39104}
39105__ai bfloat16x4_t vreinterpret_bf16_u16(uint16x4_t __p0) {
39106 bfloat16x4_t __ret;
39107 __ret = (bfloat16x4_t)(__p0);
39108 return __ret;
39109}
39110__ai bfloat16x4_t vreinterpret_bf16_s8(int8x8_t __p0) {
39111 bfloat16x4_t __ret;
39112 __ret = (bfloat16x4_t)(__p0);
39113 return __ret;
39114}
39115__ai bfloat16x4_t vreinterpret_bf16_f32(float32x2_t __p0) {
39116 bfloat16x4_t __ret;
39117 __ret = (bfloat16x4_t)(__p0);
39118 return __ret;
39119}
39120__ai bfloat16x4_t vreinterpret_bf16_f16(float16x4_t __p0) {
39121 bfloat16x4_t __ret;
39122 __ret = (bfloat16x4_t)(__p0);
39123 return __ret;
39124}
39125__ai bfloat16x4_t vreinterpret_bf16_s32(int32x2_t __p0) {
39126 bfloat16x4_t __ret;
39127 __ret = (bfloat16x4_t)(__p0);
39128 return __ret;
39129}
39130__ai bfloat16x4_t vreinterpret_bf16_s64(int64x1_t __p0) {
39131 bfloat16x4_t __ret;
39132 __ret = (bfloat16x4_t)(__p0);
39133 return __ret;
39134}
39135__ai bfloat16x4_t vreinterpret_bf16_s16(int16x4_t __p0) {
39136 bfloat16x4_t __ret;
39137 __ret = (bfloat16x4_t)(__p0);
39138 return __ret;
39139}
39140#endif
39141#if defined(__ARM_FEATURE_BF16) && defined(__aarch64__)
39142__ai poly8x8_t vreinterpret_p8_bf16(bfloat16x4_t __p0) {
39143 poly8x8_t __ret;
39144 __ret = (poly8x8_t)(__p0);
39145 return __ret;
39146}
39147__ai poly64x1_t vreinterpret_p64_bf16(bfloat16x4_t __p0) {
39148 poly64x1_t __ret;
39149 __ret = (poly64x1_t)(__p0);
39150 return __ret;
39151}
39152__ai poly16x4_t vreinterpret_p16_bf16(bfloat16x4_t __p0) {
39153 poly16x4_t __ret;
39154 __ret = (poly16x4_t)(__p0);
39155 return __ret;
39156}
39157__ai poly8x16_t vreinterpretq_p8_bf16(bfloat16x8_t __p0) {
39158 poly8x16_t __ret;
39159 __ret = (poly8x16_t)(__p0);
40604 __ret = (uint32x4_t) __builtin_neon_vcvtaq_u32_v((int8x16_t)__p0, 50);
3916040605 return __ret;
3916140606}
39162__ai poly128_t vreinterpretq_p128_bf16(bfloat16x8_t __p0) {
39163 poly128_t __ret;
39164 __ret = (poly128_t)(__p0);
40607#else
40608__ai uint32x4_t vcvtaq_u32_f32(float32x4_t __p0) {
40609 uint32x4_t __ret;
40610 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
40611 __ret = (uint32x4_t) __builtin_neon_vcvtaq_u32_v((int8x16_t)__rev0, 50);
40612 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3916540613 return __ret;
3916640614}
39167__ai poly64x2_t vreinterpretq_p64_bf16(bfloat16x8_t __p0) {
39168 poly64x2_t __ret;
39169 __ret = (poly64x2_t)(__p0);
40615#endif
40616
40617#ifdef __LITTLE_ENDIAN__
40618__ai uint32x2_t vcvta_u32_f32(float32x2_t __p0) {
40619 uint32x2_t __ret;
40620 __ret = (uint32x2_t) __builtin_neon_vcvta_u32_v((int8x8_t)__p0, 18);
3917040621 return __ret;
3917140622}
39172__ai poly16x8_t vreinterpretq_p16_bf16(bfloat16x8_t __p0) {
39173 poly16x8_t __ret;
39174 __ret = (poly16x8_t)(__p0);
40623#else
40624__ai uint32x2_t vcvta_u32_f32(float32x2_t __p0) {
40625 uint32x2_t __ret;
40626 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
40627 __ret = (uint32x2_t) __builtin_neon_vcvta_u32_v((int8x8_t)__rev0, 18);
40628 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
3917540629 return __ret;
3917640630}
39177__ai uint8x16_t vreinterpretq_u8_bf16(bfloat16x8_t __p0) {
39178 uint8x16_t __ret;
39179 __ret = (uint8x16_t)(__p0);
40631#endif
40632
40633#ifdef __LITTLE_ENDIAN__
40634__ai int32x4_t vcvtmq_s32_f32(float32x4_t __p0) {
40635 int32x4_t __ret;
40636 __ret = (int32x4_t) __builtin_neon_vcvtmq_s32_v((int8x16_t)__p0, 34);
3918040637 return __ret;
3918140638}
39182__ai uint32x4_t vreinterpretq_u32_bf16(bfloat16x8_t __p0) {
39183 uint32x4_t __ret;
39184 __ret = (uint32x4_t)(__p0);
40639#else
40640__ai int32x4_t vcvtmq_s32_f32(float32x4_t __p0) {
40641 int32x4_t __ret;
40642 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
40643 __ret = (int32x4_t) __builtin_neon_vcvtmq_s32_v((int8x16_t)__rev0, 34);
40644 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3918540645 return __ret;
3918640646}
39187__ai uint64x2_t vreinterpretq_u64_bf16(bfloat16x8_t __p0) {
39188 uint64x2_t __ret;
39189 __ret = (uint64x2_t)(__p0);
40647#endif
40648
40649#ifdef __LITTLE_ENDIAN__
40650__ai int32x2_t vcvtm_s32_f32(float32x2_t __p0) {
40651 int32x2_t __ret;
40652 __ret = (int32x2_t) __builtin_neon_vcvtm_s32_v((int8x8_t)__p0, 2);
3919040653 return __ret;
3919140654}
39192__ai uint16x8_t vreinterpretq_u16_bf16(bfloat16x8_t __p0) {
39193 uint16x8_t __ret;
39194 __ret = (uint16x8_t)(__p0);
40655#else
40656__ai int32x2_t vcvtm_s32_f32(float32x2_t __p0) {
40657 int32x2_t __ret;
40658 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
40659 __ret = (int32x2_t) __builtin_neon_vcvtm_s32_v((int8x8_t)__rev0, 2);
40660 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
3919540661 return __ret;
3919640662}
39197__ai int8x16_t vreinterpretq_s8_bf16(bfloat16x8_t __p0) {
39198 int8x16_t __ret;
39199 __ret = (int8x16_t)(__p0);
40663#endif
40664
40665#ifdef __LITTLE_ENDIAN__
40666__ai uint32x4_t vcvtmq_u32_f32(float32x4_t __p0) {
40667 uint32x4_t __ret;
40668 __ret = (uint32x4_t) __builtin_neon_vcvtmq_u32_v((int8x16_t)__p0, 50);
3920040669 return __ret;
3920140670}
39202__ai float64x2_t vreinterpretq_f64_bf16(bfloat16x8_t __p0) {
39203 float64x2_t __ret;
39204 __ret = (float64x2_t)(__p0);
40671#else
40672__ai uint32x4_t vcvtmq_u32_f32(float32x4_t __p0) {
40673 uint32x4_t __ret;
40674 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
40675 __ret = (uint32x4_t) __builtin_neon_vcvtmq_u32_v((int8x16_t)__rev0, 50);
40676 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3920540677 return __ret;
3920640678}
39207__ai float32x4_t vreinterpretq_f32_bf16(bfloat16x8_t __p0) {
39208 float32x4_t __ret;
39209 __ret = (float32x4_t)(__p0);
40679#endif
40680
40681#ifdef __LITTLE_ENDIAN__
40682__ai uint32x2_t vcvtm_u32_f32(float32x2_t __p0) {
40683 uint32x2_t __ret;
40684 __ret = (uint32x2_t) __builtin_neon_vcvtm_u32_v((int8x8_t)__p0, 18);
3921040685 return __ret;
3921140686}
39212__ai float16x8_t vreinterpretq_f16_bf16(bfloat16x8_t __p0) {
39213 float16x8_t __ret;
39214 __ret = (float16x8_t)(__p0);
40687#else
40688__ai uint32x2_t vcvtm_u32_f32(float32x2_t __p0) {
40689 uint32x2_t __ret;
40690 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
40691 __ret = (uint32x2_t) __builtin_neon_vcvtm_u32_v((int8x8_t)__rev0, 18);
40692 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
3921540693 return __ret;
3921640694}
39217__ai int32x4_t vreinterpretq_s32_bf16(bfloat16x8_t __p0) {
40695#endif
40696
40697#ifdef __LITTLE_ENDIAN__
40698__ai int32x4_t vcvtnq_s32_f32(float32x4_t __p0) {
3921840699 int32x4_t __ret;
39219 __ret = (int32x4_t)(__p0);
40700 __ret = (int32x4_t) __builtin_neon_vcvtnq_s32_v((int8x16_t)__p0, 34);
3922040701 return __ret;
3922140702}
39222__ai int64x2_t vreinterpretq_s64_bf16(bfloat16x8_t __p0) {
39223 int64x2_t __ret;
39224 __ret = (int64x2_t)(__p0);
40703#else
40704__ai int32x4_t vcvtnq_s32_f32(float32x4_t __p0) {
40705 int32x4_t __ret;
40706 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
40707 __ret = (int32x4_t) __builtin_neon_vcvtnq_s32_v((int8x16_t)__rev0, 34);
40708 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3922540709 return __ret;
3922640710}
39227__ai int16x8_t vreinterpretq_s16_bf16(bfloat16x8_t __p0) {
39228 int16x8_t __ret;
39229 __ret = (int16x8_t)(__p0);
40711#endif
40712
40713#ifdef __LITTLE_ENDIAN__
40714__ai int32x2_t vcvtn_s32_f32(float32x2_t __p0) {
40715 int32x2_t __ret;
40716 __ret = (int32x2_t) __builtin_neon_vcvtn_s32_v((int8x8_t)__p0, 2);
3923040717 return __ret;
3923140718}
39232__ai uint8x8_t vreinterpret_u8_bf16(bfloat16x4_t __p0) {
39233 uint8x8_t __ret;
39234 __ret = (uint8x8_t)(__p0);
40719#else
40720__ai int32x2_t vcvtn_s32_f32(float32x2_t __p0) {
40721 int32x2_t __ret;
40722 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
40723 __ret = (int32x2_t) __builtin_neon_vcvtn_s32_v((int8x8_t)__rev0, 2);
40724 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
3923540725 return __ret;
3923640726}
39237__ai uint32x2_t vreinterpret_u32_bf16(bfloat16x4_t __p0) {
39238 uint32x2_t __ret;
39239 __ret = (uint32x2_t)(__p0);
40727#endif
40728
40729#ifdef __LITTLE_ENDIAN__
40730__ai uint32x4_t vcvtnq_u32_f32(float32x4_t __p0) {
40731 uint32x4_t __ret;
40732 __ret = (uint32x4_t) __builtin_neon_vcvtnq_u32_v((int8x16_t)__p0, 50);
3924040733 return __ret;
3924140734}
39242__ai uint64x1_t vreinterpret_u64_bf16(bfloat16x4_t __p0) {
39243 uint64x1_t __ret;
39244 __ret = (uint64x1_t)(__p0);
40735#else
40736__ai uint32x4_t vcvtnq_u32_f32(float32x4_t __p0) {
40737 uint32x4_t __ret;
40738 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
40739 __ret = (uint32x4_t) __builtin_neon_vcvtnq_u32_v((int8x16_t)__rev0, 50);
40740 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3924540741 return __ret;
3924640742}
39247__ai uint16x4_t vreinterpret_u16_bf16(bfloat16x4_t __p0) {
39248 uint16x4_t __ret;
39249 __ret = (uint16x4_t)(__p0);
40743#endif
40744
40745#ifdef __LITTLE_ENDIAN__
40746__ai uint32x2_t vcvtn_u32_f32(float32x2_t __p0) {
40747 uint32x2_t __ret;
40748 __ret = (uint32x2_t) __builtin_neon_vcvtn_u32_v((int8x8_t)__p0, 18);
3925040749 return __ret;
3925140750}
39252__ai int8x8_t vreinterpret_s8_bf16(bfloat16x4_t __p0) {
39253 int8x8_t __ret;
39254 __ret = (int8x8_t)(__p0);
40751#else
40752__ai uint32x2_t vcvtn_u32_f32(float32x2_t __p0) {
40753 uint32x2_t __ret;
40754 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
40755 __ret = (uint32x2_t) __builtin_neon_vcvtn_u32_v((int8x8_t)__rev0, 18);
40756 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
3925540757 return __ret;
3925640758}
39257__ai float64x1_t vreinterpret_f64_bf16(bfloat16x4_t __p0) {
39258 float64x1_t __ret;
39259 __ret = (float64x1_t)(__p0);
40759#endif
40760
40761#ifdef __LITTLE_ENDIAN__
40762__ai int32x4_t vcvtpq_s32_f32(float32x4_t __p0) {
40763 int32x4_t __ret;
40764 __ret = (int32x4_t) __builtin_neon_vcvtpq_s32_v((int8x16_t)__p0, 34);
3926040765 return __ret;
3926140766}
39262__ai float32x2_t vreinterpret_f32_bf16(bfloat16x4_t __p0) {
39263 float32x2_t __ret;
39264 __ret = (float32x2_t)(__p0);
40767#else
40768__ai int32x4_t vcvtpq_s32_f32(float32x4_t __p0) {
40769 int32x4_t __ret;
40770 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
40771 __ret = (int32x4_t) __builtin_neon_vcvtpq_s32_v((int8x16_t)__rev0, 34);
40772 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3926540773 return __ret;
3926640774}
39267__ai float16x4_t vreinterpret_f16_bf16(bfloat16x4_t __p0) {
39268 float16x4_t __ret;
39269 __ret = (float16x4_t)(__p0);
40775#endif
40776
40777#ifdef __LITTLE_ENDIAN__
40778__ai int32x2_t vcvtp_s32_f32(float32x2_t __p0) {
40779 int32x2_t __ret;
40780 __ret = (int32x2_t) __builtin_neon_vcvtp_s32_v((int8x8_t)__p0, 2);
3927040781 return __ret;
3927140782}
39272__ai int32x2_t vreinterpret_s32_bf16(bfloat16x4_t __p0) {
40783#else
40784__ai int32x2_t vcvtp_s32_f32(float32x2_t __p0) {
3927340785 int32x2_t __ret;
39274 __ret = (int32x2_t)(__p0);
40786 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
40787 __ret = (int32x2_t) __builtin_neon_vcvtp_s32_v((int8x8_t)__rev0, 2);
40788 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
3927540789 return __ret;
3927640790}
39277__ai int64x1_t vreinterpret_s64_bf16(bfloat16x4_t __p0) {
39278 int64x1_t __ret;
39279 __ret = (int64x1_t)(__p0);
40791#endif
40792
40793#ifdef __LITTLE_ENDIAN__
40794__ai uint32x4_t vcvtpq_u32_f32(float32x4_t __p0) {
40795 uint32x4_t __ret;
40796 __ret = (uint32x4_t) __builtin_neon_vcvtpq_u32_v((int8x16_t)__p0, 50);
3928040797 return __ret;
3928140798}
39282__ai int16x4_t vreinterpret_s16_bf16(bfloat16x4_t __p0) {
39283 int16x4_t __ret;
39284 __ret = (int16x4_t)(__p0);
40799#else
40800__ai uint32x4_t vcvtpq_u32_f32(float32x4_t __p0) {
40801 uint32x4_t __ret;
40802 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
40803 __ret = (uint32x4_t) __builtin_neon_vcvtpq_u32_v((int8x16_t)__rev0, 50);
40804 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3928540805 return __ret;
3928640806}
39287__ai bfloat16x8_t vreinterpretq_bf16_p8(poly8x16_t __p0) {
39288 bfloat16x8_t __ret;
39289 __ret = (bfloat16x8_t)(__p0);
40807#endif
40808
40809#ifdef __LITTLE_ENDIAN__
40810__ai uint32x2_t vcvtp_u32_f32(float32x2_t __p0) {
40811 uint32x2_t __ret;
40812 __ret = (uint32x2_t) __builtin_neon_vcvtp_u32_v((int8x8_t)__p0, 18);
3929040813 return __ret;
3929140814}
39292__ai bfloat16x8_t vreinterpretq_bf16_p128(poly128_t __p0) {
39293 bfloat16x8_t __ret;
39294 __ret = (bfloat16x8_t)(__p0);
40815#else
40816__ai uint32x2_t vcvtp_u32_f32(float32x2_t __p0) {
40817 uint32x2_t __ret;
40818 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
40819 __ret = (uint32x2_t) __builtin_neon_vcvtp_u32_v((int8x8_t)__rev0, 18);
40820 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
3929540821 return __ret;
3929640822}
39297__ai bfloat16x8_t vreinterpretq_bf16_p64(poly64x2_t __p0) {
39298 bfloat16x8_t __ret;
39299 __ret = (bfloat16x8_t)(__p0);
40823#endif
40824
40825#ifdef __LITTLE_ENDIAN__
40826__ai __attribute__((target("aes"))) uint8x16_t vaesdq_u8(uint8x16_t __p0, uint8x16_t __p1) {
40827 uint8x16_t __ret;
40828 __ret = (uint8x16_t) __builtin_neon_vaesdq_u8((int8x16_t)__p0, (int8x16_t)__p1, 48);
3930040829 return __ret;
3930140830}
39302__ai bfloat16x8_t vreinterpretq_bf16_p16(poly16x8_t __p0) {
39303 bfloat16x8_t __ret;
39304 __ret = (bfloat16x8_t)(__p0);
40831#else
40832__ai __attribute__((target("aes"))) uint8x16_t vaesdq_u8(uint8x16_t __p0, uint8x16_t __p1) {
40833 uint8x16_t __ret;
40834 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
40835 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
40836 __ret = (uint8x16_t) __builtin_neon_vaesdq_u8((int8x16_t)__rev0, (int8x16_t)__rev1, 48);
40837 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
3930540838 return __ret;
3930640839}
39307__ai bfloat16x8_t vreinterpretq_bf16_u8(uint8x16_t __p0) {
39308 bfloat16x8_t __ret;
39309 __ret = (bfloat16x8_t)(__p0);
40840#endif
40841
40842#ifdef __LITTLE_ENDIAN__
40843__ai __attribute__((target("aes"))) uint8x16_t vaeseq_u8(uint8x16_t __p0, uint8x16_t __p1) {
40844 uint8x16_t __ret;
40845 __ret = (uint8x16_t) __builtin_neon_vaeseq_u8((int8x16_t)__p0, (int8x16_t)__p1, 48);
3931040846 return __ret;
3931140847}
39312__ai bfloat16x8_t vreinterpretq_bf16_u32(uint32x4_t __p0) {
39313 bfloat16x8_t __ret;
39314 __ret = (bfloat16x8_t)(__p0);
40848#else
40849__ai __attribute__((target("aes"))) uint8x16_t vaeseq_u8(uint8x16_t __p0, uint8x16_t __p1) {
40850 uint8x16_t __ret;
40851 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
40852 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
40853 __ret = (uint8x16_t) __builtin_neon_vaeseq_u8((int8x16_t)__rev0, (int8x16_t)__rev1, 48);
40854 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
3931540855 return __ret;
3931640856}
39317__ai bfloat16x8_t vreinterpretq_bf16_u64(uint64x2_t __p0) {
39318 bfloat16x8_t __ret;
39319 __ret = (bfloat16x8_t)(__p0);
40857#endif
40858
40859#ifdef __LITTLE_ENDIAN__
40860__ai __attribute__((target("aes"))) uint8x16_t vaesimcq_u8(uint8x16_t __p0) {
40861 uint8x16_t __ret;
40862 __ret = (uint8x16_t) __builtin_neon_vaesimcq_u8((int8x16_t)__p0, 48);
3932040863 return __ret;
3932140864}
39322__ai bfloat16x8_t vreinterpretq_bf16_u16(uint16x8_t __p0) {
39323 bfloat16x8_t __ret;
39324 __ret = (bfloat16x8_t)(__p0);
40865#else
40866__ai __attribute__((target("aes"))) uint8x16_t vaesimcq_u8(uint8x16_t __p0) {
40867 uint8x16_t __ret;
40868 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
40869 __ret = (uint8x16_t) __builtin_neon_vaesimcq_u8((int8x16_t)__rev0, 48);
40870 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
3932540871 return __ret;
3932640872}
39327__ai bfloat16x8_t vreinterpretq_bf16_s8(int8x16_t __p0) {
39328 bfloat16x8_t __ret;
39329 __ret = (bfloat16x8_t)(__p0);
40873#endif
40874
40875#ifdef __LITTLE_ENDIAN__
40876__ai __attribute__((target("aes"))) uint8x16_t vaesmcq_u8(uint8x16_t __p0) {
40877 uint8x16_t __ret;
40878 __ret = (uint8x16_t) __builtin_neon_vaesmcq_u8((int8x16_t)__p0, 48);
3933040879 return __ret;
3933140880}
39332__ai bfloat16x8_t vreinterpretq_bf16_f64(float64x2_t __p0) {
39333 bfloat16x8_t __ret;
39334 __ret = (bfloat16x8_t)(__p0);
40881#else
40882__ai __attribute__((target("aes"))) uint8x16_t vaesmcq_u8(uint8x16_t __p0) {
40883 uint8x16_t __ret;
40884 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
40885 __ret = (uint8x16_t) __builtin_neon_vaesmcq_u8((int8x16_t)__rev0, 48);
40886 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
3933540887 return __ret;
3933640888}
39337__ai bfloat16x8_t vreinterpretq_bf16_f32(float32x4_t __p0) {
39338 bfloat16x8_t __ret;
39339 __ret = (bfloat16x8_t)(__p0);
40889#endif
40890
40891#ifdef __LITTLE_ENDIAN__
40892__ai __attribute__((target("sha2"))) uint32x4_t vsha1cq_u32(uint32x4_t __p0, uint32_t __p1, uint32x4_t __p2) {
40893 uint32x4_t __ret;
40894 __ret = (uint32x4_t) __builtin_neon_vsha1cq_u32(__p0, __p1, __p2);
3934040895 return __ret;
3934140896}
39342__ai bfloat16x8_t vreinterpretq_bf16_f16(float16x8_t __p0) {
39343 bfloat16x8_t __ret;
39344 __ret = (bfloat16x8_t)(__p0);
40897#else
40898__ai __attribute__((target("sha2"))) uint32x4_t vsha1cq_u32(uint32x4_t __p0, uint32_t __p1, uint32x4_t __p2) {
40899 uint32x4_t __ret;
40900 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
40901 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
40902 __ret = (uint32x4_t) __builtin_neon_vsha1cq_u32(__rev0, __p1, __rev2);
40903 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3934540904 return __ret;
3934640905}
39347__ai bfloat16x8_t vreinterpretq_bf16_s32(int32x4_t __p0) {
39348 bfloat16x8_t __ret;
39349 __ret = (bfloat16x8_t)(__p0);
40906#endif
40907
40908__ai __attribute__((target("sha2"))) uint32_t vsha1h_u32(uint32_t __p0) {
40909 uint32_t __ret;
40910 __ret = (uint32_t) __builtin_neon_vsha1h_u32(__p0);
3935040911 return __ret;
3935140912}
39352__ai bfloat16x8_t vreinterpretq_bf16_s64(int64x2_t __p0) {
39353 bfloat16x8_t __ret;
39354 __ret = (bfloat16x8_t)(__p0);
40913#ifdef __LITTLE_ENDIAN__
40914__ai __attribute__((target("sha2"))) uint32x4_t vsha1mq_u32(uint32x4_t __p0, uint32_t __p1, uint32x4_t __p2) {
40915 uint32x4_t __ret;
40916 __ret = (uint32x4_t) __builtin_neon_vsha1mq_u32(__p0, __p1, __p2);
3935540917 return __ret;
3935640918}
39357__ai bfloat16x8_t vreinterpretq_bf16_s16(int16x8_t __p0) {
39358 bfloat16x8_t __ret;
39359 __ret = (bfloat16x8_t)(__p0);
40919#else
40920__ai __attribute__((target("sha2"))) uint32x4_t vsha1mq_u32(uint32x4_t __p0, uint32_t __p1, uint32x4_t __p2) {
40921 uint32x4_t __ret;
40922 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
40923 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
40924 __ret = (uint32x4_t) __builtin_neon_vsha1mq_u32(__rev0, __p1, __rev2);
40925 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3936040926 return __ret;
3936140927}
39362__ai bfloat16x4_t vreinterpret_bf16_p8(poly8x8_t __p0) {
39363 bfloat16x4_t __ret;
39364 __ret = (bfloat16x4_t)(__p0);
40928#endif
40929
40930#ifdef __LITTLE_ENDIAN__
40931__ai __attribute__((target("sha2"))) uint32x4_t vsha1pq_u32(uint32x4_t __p0, uint32_t __p1, uint32x4_t __p2) {
40932 uint32x4_t __ret;
40933 __ret = (uint32x4_t) __builtin_neon_vsha1pq_u32(__p0, __p1, __p2);
3936540934 return __ret;
3936640935}
39367__ai bfloat16x4_t vreinterpret_bf16_p64(poly64x1_t __p0) {
39368 bfloat16x4_t __ret;
39369 __ret = (bfloat16x4_t)(__p0);
40936#else
40937__ai __attribute__((target("sha2"))) uint32x4_t vsha1pq_u32(uint32x4_t __p0, uint32_t __p1, uint32x4_t __p2) {
40938 uint32x4_t __ret;
40939 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
40940 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
40941 __ret = (uint32x4_t) __builtin_neon_vsha1pq_u32(__rev0, __p1, __rev2);
40942 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3937040943 return __ret;
3937140944}
39372__ai bfloat16x4_t vreinterpret_bf16_p16(poly16x4_t __p0) {
39373 bfloat16x4_t __ret;
39374 __ret = (bfloat16x4_t)(__p0);
40945#endif
40946
40947#ifdef __LITTLE_ENDIAN__
40948__ai __attribute__((target("sha2"))) uint32x4_t vsha1su0q_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
40949 uint32x4_t __ret;
40950 __ret = (uint32x4_t) __builtin_neon_vsha1su0q_u32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 50);
3937540951 return __ret;
3937640952}
39377__ai bfloat16x4_t vreinterpret_bf16_u8(uint8x8_t __p0) {
39378 bfloat16x4_t __ret;
39379 __ret = (bfloat16x4_t)(__p0);
40953#else
40954__ai __attribute__((target("sha2"))) uint32x4_t vsha1su0q_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
40955 uint32x4_t __ret;
40956 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
40957 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
40958 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
40959 __ret = (uint32x4_t) __builtin_neon_vsha1su0q_u32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 50);
40960 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3938040961 return __ret;
3938140962}
39382__ai bfloat16x4_t vreinterpret_bf16_u32(uint32x2_t __p0) {
39383 bfloat16x4_t __ret;
39384 __ret = (bfloat16x4_t)(__p0);
40963#endif
40964
40965#ifdef __LITTLE_ENDIAN__
40966__ai __attribute__((target("sha2"))) uint32x4_t vsha1su1q_u32(uint32x4_t __p0, uint32x4_t __p1) {
40967 uint32x4_t __ret;
40968 __ret = (uint32x4_t) __builtin_neon_vsha1su1q_u32((int8x16_t)__p0, (int8x16_t)__p1, 50);
3938540969 return __ret;
3938640970}
39387__ai bfloat16x4_t vreinterpret_bf16_u64(uint64x1_t __p0) {
39388 bfloat16x4_t __ret;
39389 __ret = (bfloat16x4_t)(__p0);
40971#else
40972__ai __attribute__((target("sha2"))) uint32x4_t vsha1su1q_u32(uint32x4_t __p0, uint32x4_t __p1) {
40973 uint32x4_t __ret;
40974 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
40975 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
40976 __ret = (uint32x4_t) __builtin_neon_vsha1su1q_u32((int8x16_t)__rev0, (int8x16_t)__rev1, 50);
40977 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3939040978 return __ret;
3939140979}
39392__ai bfloat16x4_t vreinterpret_bf16_u16(uint16x4_t __p0) {
39393 bfloat16x4_t __ret;
39394 __ret = (bfloat16x4_t)(__p0);
40980#endif
40981
40982#ifdef __LITTLE_ENDIAN__
40983__ai __attribute__((target("sha2"))) uint32x4_t vsha256hq_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
40984 uint32x4_t __ret;
40985 __ret = (uint32x4_t) __builtin_neon_vsha256hq_u32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 50);
3939540986 return __ret;
3939640987}
39397__ai bfloat16x4_t vreinterpret_bf16_s8(int8x8_t __p0) {
39398 bfloat16x4_t __ret;
39399 __ret = (bfloat16x4_t)(__p0);
40988#else
40989__ai __attribute__((target("sha2"))) uint32x4_t vsha256hq_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
40990 uint32x4_t __ret;
40991 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
40992 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
40993 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
40994 __ret = (uint32x4_t) __builtin_neon_vsha256hq_u32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 50);
40995 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3940040996 return __ret;
3940140997}
39402__ai bfloat16x4_t vreinterpret_bf16_f64(float64x1_t __p0) {
39403 bfloat16x4_t __ret;
39404 __ret = (bfloat16x4_t)(__p0);
40998#endif
40999
41000#ifdef __LITTLE_ENDIAN__
41001__ai __attribute__((target("sha2"))) uint32x4_t vsha256h2q_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
41002 uint32x4_t __ret;
41003 __ret = (uint32x4_t) __builtin_neon_vsha256h2q_u32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 50);
3940541004 return __ret;
3940641005}
39407__ai bfloat16x4_t vreinterpret_bf16_f32(float32x2_t __p0) {
39408 bfloat16x4_t __ret;
39409 __ret = (bfloat16x4_t)(__p0);
41006#else
41007__ai __attribute__((target("sha2"))) uint32x4_t vsha256h2q_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
41008 uint32x4_t __ret;
41009 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41010 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
41011 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
41012 __ret = (uint32x4_t) __builtin_neon_vsha256h2q_u32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 50);
41013 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3941041014 return __ret;
3941141015}
39412__ai bfloat16x4_t vreinterpret_bf16_f16(float16x4_t __p0) {
39413 bfloat16x4_t __ret;
39414 __ret = (bfloat16x4_t)(__p0);
41016#endif
41017
41018#ifdef __LITTLE_ENDIAN__
41019__ai __attribute__((target("sha2"))) uint32x4_t vsha256su0q_u32(uint32x4_t __p0, uint32x4_t __p1) {
41020 uint32x4_t __ret;
41021 __ret = (uint32x4_t) __builtin_neon_vsha256su0q_u32((int8x16_t)__p0, (int8x16_t)__p1, 50);
3941541022 return __ret;
3941641023}
39417__ai bfloat16x4_t vreinterpret_bf16_s32(int32x2_t __p0) {
39418 bfloat16x4_t __ret;
39419 __ret = (bfloat16x4_t)(__p0);
41024#else
41025__ai __attribute__((target("sha2"))) uint32x4_t vsha256su0q_u32(uint32x4_t __p0, uint32x4_t __p1) {
41026 uint32x4_t __ret;
41027 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41028 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
41029 __ret = (uint32x4_t) __builtin_neon_vsha256su0q_u32((int8x16_t)__rev0, (int8x16_t)__rev1, 50);
41030 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3942041031 return __ret;
3942141032}
39422__ai bfloat16x4_t vreinterpret_bf16_s64(int64x1_t __p0) {
39423 bfloat16x4_t __ret;
39424 __ret = (bfloat16x4_t)(__p0);
41033#endif
41034
41035#ifdef __LITTLE_ENDIAN__
41036__ai __attribute__((target("sha2"))) uint32x4_t vsha256su1q_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
41037 uint32x4_t __ret;
41038 __ret = (uint32x4_t) __builtin_neon_vsha256su1q_u32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 50);
3942541039 return __ret;
3942641040}
39427__ai bfloat16x4_t vreinterpret_bf16_s16(int16x4_t __p0) {
39428 bfloat16x4_t __ret;
39429 __ret = (bfloat16x4_t)(__p0);
41041#else
41042__ai __attribute__((target("sha2"))) uint32x4_t vsha256su1q_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
41043 uint32x4_t __ret;
41044 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41045 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
41046 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
41047 __ret = (uint32x4_t) __builtin_neon_vsha256su1q_u32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 50);
41048 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3943041049 return __ret;
3943141050}
3943241051#endif
39433#if defined(__ARM_FEATURE_BF16_VECTOR_ARITHMETIC)
41052
41053#endif
41054#if __ARM_ARCH >= 8 && defined(__ARM_FEATURE_DIRECTED_ROUNDING)
3943441055#ifdef __LITTLE_ENDIAN__
39435#define splatq_lane_bf16(__p0, __p1) __extension__ ({ \
39436 bfloat16x8_t __ret; \
39437 bfloat16x4_t __s0 = __p0; \
39438 __ret = (bfloat16x8_t) __builtin_neon_splatq_lane_v((int8x8_t)__s0, __p1, 11); \
39439 __ret; \
39440})
41056__ai float32x4_t vrndq_f32(float32x4_t __p0) {
41057 float32x4_t __ret;
41058 __ret = (float32x4_t) __builtin_neon_vrndq_v((int8x16_t)__p0, 41);
41059 return __ret;
41060}
3944141061#else
39442#define splatq_lane_bf16(__p0, __p1) __extension__ ({ \
39443 bfloat16x8_t __ret; \
39444 bfloat16x4_t __s0 = __p0; \
39445 bfloat16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
39446 __ret = (bfloat16x8_t) __builtin_neon_splatq_lane_v((int8x8_t)__rev0, __p1, 11); \
39447 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
39448 __ret; \
39449})
39450#define __noswap_splatq_lane_bf16(__p0, __p1) __extension__ ({ \
39451 bfloat16x8_t __ret; \
39452 bfloat16x4_t __s0 = __p0; \
39453 __ret = (bfloat16x8_t) __builtin_neon_splatq_lane_v((int8x8_t)__s0, __p1, 11); \
39454 __ret; \
39455})
41062__ai float32x4_t vrndq_f32(float32x4_t __p0) {
41063 float32x4_t __ret;
41064 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41065 __ret = (float32x4_t) __builtin_neon_vrndq_v((int8x16_t)__rev0, 41);
41066 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
41067 return __ret;
41068}
3945641069#endif
3945741070
3945841071#ifdef __LITTLE_ENDIAN__
39459#define splat_lane_bf16(__p0, __p1) __extension__ ({ \
39460 bfloat16x4_t __ret; \
39461 bfloat16x4_t __s0 = __p0; \
39462 __ret = (bfloat16x4_t) __builtin_neon_splat_lane_v((int8x8_t)__s0, __p1, 11); \
39463 __ret; \
39464})
41072__ai float32x2_t vrnd_f32(float32x2_t __p0) {
41073 float32x2_t __ret;
41074 __ret = (float32x2_t) __builtin_neon_vrnd_v((int8x8_t)__p0, 9);
41075 return __ret;
41076}
3946541077#else
39466#define splat_lane_bf16(__p0, __p1) __extension__ ({ \
39467 bfloat16x4_t __ret; \
39468 bfloat16x4_t __s0 = __p0; \
39469 bfloat16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
39470 __ret = (bfloat16x4_t) __builtin_neon_splat_lane_v((int8x8_t)__rev0, __p1, 11); \
39471 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
39472 __ret; \
39473})
39474#define __noswap_splat_lane_bf16(__p0, __p1) __extension__ ({ \
39475 bfloat16x4_t __ret; \
39476 bfloat16x4_t __s0 = __p0; \
39477 __ret = (bfloat16x4_t) __builtin_neon_splat_lane_v((int8x8_t)__s0, __p1, 11); \
39478 __ret; \
39479})
41078__ai float32x2_t vrnd_f32(float32x2_t __p0) {
41079 float32x2_t __ret;
41080 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
41081 __ret = (float32x2_t) __builtin_neon_vrnd_v((int8x8_t)__rev0, 9);
41082 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
41083 return __ret;
41084}
3948041085#endif
3948141086
3948241087#ifdef __LITTLE_ENDIAN__
39483#define splatq_laneq_bf16(__p0, __p1) __extension__ ({ \
39484 bfloat16x8_t __ret; \
39485 bfloat16x8_t __s0 = __p0; \
39486 __ret = (bfloat16x8_t) __builtin_neon_splatq_laneq_v((int8x16_t)__s0, __p1, 43); \
39487 __ret; \
39488})
41088__ai float32x4_t vrndaq_f32(float32x4_t __p0) {
41089 float32x4_t __ret;
41090 __ret = (float32x4_t) __builtin_neon_vrndaq_v((int8x16_t)__p0, 41);
41091 return __ret;
41092}
3948941093#else
39490#define splatq_laneq_bf16(__p0, __p1) __extension__ ({ \
39491 bfloat16x8_t __ret; \
39492 bfloat16x8_t __s0 = __p0; \
39493 bfloat16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
39494 __ret = (bfloat16x8_t) __builtin_neon_splatq_laneq_v((int8x16_t)__rev0, __p1, 43); \
39495 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
39496 __ret; \
39497})
39498#define __noswap_splatq_laneq_bf16(__p0, __p1) __extension__ ({ \
39499 bfloat16x8_t __ret; \
39500 bfloat16x8_t __s0 = __p0; \
39501 __ret = (bfloat16x8_t) __builtin_neon_splatq_laneq_v((int8x16_t)__s0, __p1, 43); \
39502 __ret; \
39503})
41094__ai float32x4_t vrndaq_f32(float32x4_t __p0) {
41095 float32x4_t __ret;
41096 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41097 __ret = (float32x4_t) __builtin_neon_vrndaq_v((int8x16_t)__rev0, 41);
41098 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
41099 return __ret;
41100}
3950441101#endif
3950541102
3950641103#ifdef __LITTLE_ENDIAN__
39507#define splat_laneq_bf16(__p0, __p1) __extension__ ({ \
39508 bfloat16x4_t __ret; \
39509 bfloat16x8_t __s0 = __p0; \
39510 __ret = (bfloat16x4_t) __builtin_neon_splat_laneq_v((int8x16_t)__s0, __p1, 43); \
39511 __ret; \
39512})
41104__ai float32x2_t vrnda_f32(float32x2_t __p0) {
41105 float32x2_t __ret;
41106 __ret = (float32x2_t) __builtin_neon_vrnda_v((int8x8_t)__p0, 9);
41107 return __ret;
41108}
3951341109#else
39514#define splat_laneq_bf16(__p0, __p1) __extension__ ({ \
39515 bfloat16x4_t __ret; \
39516 bfloat16x8_t __s0 = __p0; \
39517 bfloat16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
39518 __ret = (bfloat16x4_t) __builtin_neon_splat_laneq_v((int8x16_t)__rev0, __p1, 43); \
39519 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
39520 __ret; \
39521})
39522#define __noswap_splat_laneq_bf16(__p0, __p1) __extension__ ({ \
39523 bfloat16x4_t __ret; \
39524 bfloat16x8_t __s0 = __p0; \
39525 __ret = (bfloat16x4_t) __builtin_neon_splat_laneq_v((int8x16_t)__s0, __p1, 43); \
39526 __ret; \
39527})
41110__ai float32x2_t vrnda_f32(float32x2_t __p0) {
41111 float32x2_t __ret;
41112 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
41113 __ret = (float32x2_t) __builtin_neon_vrnda_v((int8x8_t)__rev0, 9);
41114 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
41115 return __ret;
41116}
3952841117#endif
3952941118
3953041119#ifdef __LITTLE_ENDIAN__
39531__ai float32x4_t vbfdotq_f32(float32x4_t __p0, bfloat16x8_t __p1, bfloat16x8_t __p2) {
41120__ai float32x4_t vrndiq_f32(float32x4_t __p0) {
3953241121 float32x4_t __ret;
39533 __ret = (float32x4_t) __builtin_neon_vbfdotq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
41122 __ret = (float32x4_t) __builtin_neon_vrndiq_v((int8x16_t)__p0, 41);
3953441123 return __ret;
3953541124}
3953641125#else
39537__ai float32x4_t vbfdotq_f32(float32x4_t __p0, bfloat16x8_t __p1, bfloat16x8_t __p2) {
41126__ai float32x4_t vrndiq_f32(float32x4_t __p0) {
3953841127 float32x4_t __ret;
3953941128 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
39540 bfloat16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
39541 bfloat16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
39542 __ret = (float32x4_t) __builtin_neon_vbfdotq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 41);
41129 __ret = (float32x4_t) __builtin_neon_vrndiq_v((int8x16_t)__rev0, 41);
3954341130 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3954441131 return __ret;
3954541132}
39546__ai float32x4_t __noswap_vbfdotq_f32(float32x4_t __p0, bfloat16x8_t __p1, bfloat16x8_t __p2) {
39547 float32x4_t __ret;
39548 __ret = (float32x4_t) __builtin_neon_vbfdotq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
39549 return __ret;
39550}
3955141133#endif
3955241134
3955341135#ifdef __LITTLE_ENDIAN__
39554__ai float32x2_t vbfdot_f32(float32x2_t __p0, bfloat16x4_t __p1, bfloat16x4_t __p2) {
41136__ai float32x2_t vrndi_f32(float32x2_t __p0) {
3955541137 float32x2_t __ret;
39556 __ret = (float32x2_t) __builtin_neon_vbfdot_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
41138 __ret = (float32x2_t) __builtin_neon_vrndi_v((int8x8_t)__p0, 9);
3955741139 return __ret;
3955841140}
3955941141#else
39560__ai float32x2_t vbfdot_f32(float32x2_t __p0, bfloat16x4_t __p1, bfloat16x4_t __p2) {
41142__ai float32x2_t vrndi_f32(float32x2_t __p0) {
3956141143 float32x2_t __ret;
3956241144 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
39563 bfloat16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
39564 bfloat16x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
39565 __ret = (float32x2_t) __builtin_neon_vbfdot_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 9);
41145 __ret = (float32x2_t) __builtin_neon_vrndi_v((int8x8_t)__rev0, 9);
3956641146 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
3956741147 return __ret;
3956841148}
39569__ai float32x2_t __noswap_vbfdot_f32(float32x2_t __p0, bfloat16x4_t __p1, bfloat16x4_t __p2) {
39570 float32x2_t __ret;
39571 __ret = (float32x2_t) __builtin_neon_vbfdot_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
39572 return __ret;
39573}
39574#endif
39575
39576#ifdef __LITTLE_ENDIAN__
39577#define vbfdotq_lane_f32(__p0_142, __p1_142, __p2_142, __p3_142) __extension__ ({ \
39578 float32x4_t __ret_142; \
39579 float32x4_t __s0_142 = __p0_142; \
39580 bfloat16x8_t __s1_142 = __p1_142; \
39581 bfloat16x4_t __s2_142 = __p2_142; \
39582bfloat16x4_t __reint_142 = __s2_142; \
39583float32x4_t __reint1_142 = splatq_lane_f32(*(float32x2_t *) &__reint_142, __p3_142); \
39584 __ret_142 = vbfdotq_f32(__s0_142, __s1_142, *(bfloat16x8_t *) &__reint1_142); \
39585 __ret_142; \
39586})
39587#else
39588#define vbfdotq_lane_f32(__p0_143, __p1_143, __p2_143, __p3_143) __extension__ ({ \
39589 float32x4_t __ret_143; \
39590 float32x4_t __s0_143 = __p0_143; \
39591 bfloat16x8_t __s1_143 = __p1_143; \
39592 bfloat16x4_t __s2_143 = __p2_143; \
39593 float32x4_t __rev0_143; __rev0_143 = __builtin_shufflevector(__s0_143, __s0_143, 3, 2, 1, 0); \
39594 bfloat16x8_t __rev1_143; __rev1_143 = __builtin_shufflevector(__s1_143, __s1_143, 7, 6, 5, 4, 3, 2, 1, 0); \
39595 bfloat16x4_t __rev2_143; __rev2_143 = __builtin_shufflevector(__s2_143, __s2_143, 3, 2, 1, 0); \
39596bfloat16x4_t __reint_143 = __rev2_143; \
39597float32x4_t __reint1_143 = __noswap_splatq_lane_f32(*(float32x2_t *) &__reint_143, __p3_143); \
39598 __ret_143 = __noswap_vbfdotq_f32(__rev0_143, __rev1_143, *(bfloat16x8_t *) &__reint1_143); \
39599 __ret_143 = __builtin_shufflevector(__ret_143, __ret_143, 3, 2, 1, 0); \
39600 __ret_143; \
39601})
39602#endif
39603
39604#ifdef __LITTLE_ENDIAN__
39605#define vbfdot_lane_f32(__p0_144, __p1_144, __p2_144, __p3_144) __extension__ ({ \
39606 float32x2_t __ret_144; \
39607 float32x2_t __s0_144 = __p0_144; \
39608 bfloat16x4_t __s1_144 = __p1_144; \
39609 bfloat16x4_t __s2_144 = __p2_144; \
39610bfloat16x4_t __reint_144 = __s2_144; \
39611float32x2_t __reint1_144 = splat_lane_f32(*(float32x2_t *) &__reint_144, __p3_144); \
39612 __ret_144 = vbfdot_f32(__s0_144, __s1_144, *(bfloat16x4_t *) &__reint1_144); \
39613 __ret_144; \
39614})
39615#else
39616#define vbfdot_lane_f32(__p0_145, __p1_145, __p2_145, __p3_145) __extension__ ({ \
39617 float32x2_t __ret_145; \
39618 float32x2_t __s0_145 = __p0_145; \
39619 bfloat16x4_t __s1_145 = __p1_145; \
39620 bfloat16x4_t __s2_145 = __p2_145; \
39621 float32x2_t __rev0_145; __rev0_145 = __builtin_shufflevector(__s0_145, __s0_145, 1, 0); \
39622 bfloat16x4_t __rev1_145; __rev1_145 = __builtin_shufflevector(__s1_145, __s1_145, 3, 2, 1, 0); \
39623 bfloat16x4_t __rev2_145; __rev2_145 = __builtin_shufflevector(__s2_145, __s2_145, 3, 2, 1, 0); \
39624bfloat16x4_t __reint_145 = __rev2_145; \
39625float32x2_t __reint1_145 = __noswap_splat_lane_f32(*(float32x2_t *) &__reint_145, __p3_145); \
39626 __ret_145 = __noswap_vbfdot_f32(__rev0_145, __rev1_145, *(bfloat16x4_t *) &__reint1_145); \
39627 __ret_145 = __builtin_shufflevector(__ret_145, __ret_145, 1, 0); \
39628 __ret_145; \
39629})
39630#endif
39631
39632#ifdef __LITTLE_ENDIAN__
39633#define vbfdotq_laneq_f32(__p0_146, __p1_146, __p2_146, __p3_146) __extension__ ({ \
39634 float32x4_t __ret_146; \
39635 float32x4_t __s0_146 = __p0_146; \
39636 bfloat16x8_t __s1_146 = __p1_146; \
39637 bfloat16x8_t __s2_146 = __p2_146; \
39638bfloat16x8_t __reint_146 = __s2_146; \
39639float32x4_t __reint1_146 = splatq_laneq_f32(*(float32x4_t *) &__reint_146, __p3_146); \
39640 __ret_146 = vbfdotq_f32(__s0_146, __s1_146, *(bfloat16x8_t *) &__reint1_146); \
39641 __ret_146; \
39642})
39643#else
39644#define vbfdotq_laneq_f32(__p0_147, __p1_147, __p2_147, __p3_147) __extension__ ({ \
39645 float32x4_t __ret_147; \
39646 float32x4_t __s0_147 = __p0_147; \
39647 bfloat16x8_t __s1_147 = __p1_147; \
39648 bfloat16x8_t __s2_147 = __p2_147; \
39649 float32x4_t __rev0_147; __rev0_147 = __builtin_shufflevector(__s0_147, __s0_147, 3, 2, 1, 0); \
39650 bfloat16x8_t __rev1_147; __rev1_147 = __builtin_shufflevector(__s1_147, __s1_147, 7, 6, 5, 4, 3, 2, 1, 0); \
39651 bfloat16x8_t __rev2_147; __rev2_147 = __builtin_shufflevector(__s2_147, __s2_147, 7, 6, 5, 4, 3, 2, 1, 0); \
39652bfloat16x8_t __reint_147 = __rev2_147; \
39653float32x4_t __reint1_147 = __noswap_splatq_laneq_f32(*(float32x4_t *) &__reint_147, __p3_147); \
39654 __ret_147 = __noswap_vbfdotq_f32(__rev0_147, __rev1_147, *(bfloat16x8_t *) &__reint1_147); \
39655 __ret_147 = __builtin_shufflevector(__ret_147, __ret_147, 3, 2, 1, 0); \
39656 __ret_147; \
39657})
39658#endif
39659
39660#ifdef __LITTLE_ENDIAN__
39661#define vbfdot_laneq_f32(__p0_148, __p1_148, __p2_148, __p3_148) __extension__ ({ \
39662 float32x2_t __ret_148; \
39663 float32x2_t __s0_148 = __p0_148; \
39664 bfloat16x4_t __s1_148 = __p1_148; \
39665 bfloat16x8_t __s2_148 = __p2_148; \
39666bfloat16x8_t __reint_148 = __s2_148; \
39667float32x2_t __reint1_148 = splat_laneq_f32(*(float32x4_t *) &__reint_148, __p3_148); \
39668 __ret_148 = vbfdot_f32(__s0_148, __s1_148, *(bfloat16x4_t *) &__reint1_148); \
39669 __ret_148; \
39670})
39671#else
39672#define vbfdot_laneq_f32(__p0_149, __p1_149, __p2_149, __p3_149) __extension__ ({ \
39673 float32x2_t __ret_149; \
39674 float32x2_t __s0_149 = __p0_149; \
39675 bfloat16x4_t __s1_149 = __p1_149; \
39676 bfloat16x8_t __s2_149 = __p2_149; \
39677 float32x2_t __rev0_149; __rev0_149 = __builtin_shufflevector(__s0_149, __s0_149, 1, 0); \
39678 bfloat16x4_t __rev1_149; __rev1_149 = __builtin_shufflevector(__s1_149, __s1_149, 3, 2, 1, 0); \
39679 bfloat16x8_t __rev2_149; __rev2_149 = __builtin_shufflevector(__s2_149, __s2_149, 7, 6, 5, 4, 3, 2, 1, 0); \
39680bfloat16x8_t __reint_149 = __rev2_149; \
39681float32x2_t __reint1_149 = __noswap_splat_laneq_f32(*(float32x4_t *) &__reint_149, __p3_149); \
39682 __ret_149 = __noswap_vbfdot_f32(__rev0_149, __rev1_149, *(bfloat16x4_t *) &__reint1_149); \
39683 __ret_149 = __builtin_shufflevector(__ret_149, __ret_149, 1, 0); \
39684 __ret_149; \
39685})
3968641149#endif
3968741150
3968841151#ifdef __LITTLE_ENDIAN__
39689__ai float32x4_t vbfmlalbq_f32(float32x4_t __p0, bfloat16x8_t __p1, bfloat16x8_t __p2) {
41152__ai float32x4_t vrndmq_f32(float32x4_t __p0) {
3969041153 float32x4_t __ret;
39691 __ret = (float32x4_t) __builtin_neon_vbfmlalbq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
41154 __ret = (float32x4_t) __builtin_neon_vrndmq_v((int8x16_t)__p0, 41);
3969241155 return __ret;
3969341156}
3969441157#else
39695__ai float32x4_t vbfmlalbq_f32(float32x4_t __p0, bfloat16x8_t __p1, bfloat16x8_t __p2) {
41158__ai float32x4_t vrndmq_f32(float32x4_t __p0) {
3969641159 float32x4_t __ret;
3969741160 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
39698 bfloat16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
39699 bfloat16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
39700 __ret = (float32x4_t) __builtin_neon_vbfmlalbq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 41);
41161 __ret = (float32x4_t) __builtin_neon_vrndmq_v((int8x16_t)__rev0, 41);
3970141162 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3970241163 return __ret;
3970341164}
39704__ai float32x4_t __noswap_vbfmlalbq_f32(float32x4_t __p0, bfloat16x8_t __p1, bfloat16x8_t __p2) {
39705 float32x4_t __ret;
39706 __ret = (float32x4_t) __builtin_neon_vbfmlalbq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
39707 return __ret;
39708}
3970941165#endif
3971041166
3971141167#ifdef __LITTLE_ENDIAN__
39712__ai float32x4_t vbfmlaltq_f32(float32x4_t __p0, bfloat16x8_t __p1, bfloat16x8_t __p2) {
39713 float32x4_t __ret;
39714 __ret = (float32x4_t) __builtin_neon_vbfmlaltq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
41168__ai float32x2_t vrndm_f32(float32x2_t __p0) {
41169 float32x2_t __ret;
41170 __ret = (float32x2_t) __builtin_neon_vrndm_v((int8x8_t)__p0, 9);
3971541171 return __ret;
3971641172}
3971741173#else
39718__ai float32x4_t vbfmlaltq_f32(float32x4_t __p0, bfloat16x8_t __p1, bfloat16x8_t __p2) {
39719 float32x4_t __ret;
39720 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
39721 bfloat16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
39722 bfloat16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
39723 __ret = (float32x4_t) __builtin_neon_vbfmlaltq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 41);
39724 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
39725 return __ret;
39726}
39727__ai float32x4_t __noswap_vbfmlaltq_f32(float32x4_t __p0, bfloat16x8_t __p1, bfloat16x8_t __p2) {
39728 float32x4_t __ret;
39729 __ret = (float32x4_t) __builtin_neon_vbfmlaltq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
41174__ai float32x2_t vrndm_f32(float32x2_t __p0) {
41175 float32x2_t __ret;
41176 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
41177 __ret = (float32x2_t) __builtin_neon_vrndm_v((int8x8_t)__rev0, 9);
41178 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
3973041179 return __ret;
3973141180}
3973241181#endif
3973341182
3973441183#ifdef __LITTLE_ENDIAN__
39735__ai float32x4_t vbfmmlaq_f32(float32x4_t __p0, bfloat16x8_t __p1, bfloat16x8_t __p2) {
41184__ai float32x4_t vrndnq_f32(float32x4_t __p0) {
3973641185 float32x4_t __ret;
39737 __ret = (float32x4_t) __builtin_neon_vbfmmlaq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
41186 __ret = (float32x4_t) __builtin_neon_vrndnq_v((int8x16_t)__p0, 41);
3973841187 return __ret;
3973941188}
3974041189#else
39741__ai float32x4_t vbfmmlaq_f32(float32x4_t __p0, bfloat16x8_t __p1, bfloat16x8_t __p2) {
41190__ai float32x4_t vrndnq_f32(float32x4_t __p0) {
3974241191 float32x4_t __ret;
3974341192 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
39744 bfloat16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
39745 bfloat16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
39746 __ret = (float32x4_t) __builtin_neon_vbfmmlaq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 41);
41193 __ret = (float32x4_t) __builtin_neon_vrndnq_v((int8x16_t)__rev0, 41);
3974741194 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3974841195 return __ret;
3974941196}
3975041197#endif
3975141198
3975241199#ifdef __LITTLE_ENDIAN__
39753__ai bfloat16x8_t vcombine_bf16(bfloat16x4_t __p0, bfloat16x4_t __p1) {
39754 bfloat16x8_t __ret;
39755 __ret = __builtin_shufflevector(__p0, __p1, 0, 1, 2, 3, 4, 5, 6, 7);
41200__ai float32x2_t vrndn_f32(float32x2_t __p0) {
41201 float32x2_t __ret;
41202 __ret = (float32x2_t) __builtin_neon_vrndn_v((int8x8_t)__p0, 9);
3975641203 return __ret;
3975741204}
3975841205#else
39759__ai bfloat16x8_t vcombine_bf16(bfloat16x4_t __p0, bfloat16x4_t __p1) {
39760 bfloat16x8_t __ret;
39761 bfloat16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
39762 bfloat16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
39763 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 1, 2, 3, 4, 5, 6, 7);
39764 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
39765 return __ret;
39766}
39767__ai bfloat16x8_t __noswap_vcombine_bf16(bfloat16x4_t __p0, bfloat16x4_t __p1) {
39768 bfloat16x8_t __ret;
39769 __ret = __builtin_shufflevector(__p0, __p1, 0, 1, 2, 3, 4, 5, 6, 7);
41206__ai float32x2_t vrndn_f32(float32x2_t __p0) {
41207 float32x2_t __ret;
41208 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
41209 __ret = (float32x2_t) __builtin_neon_vrndn_v((int8x8_t)__rev0, 9);
41210 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
3977041211 return __ret;
3977141212}
3977241213#endif
3977341214
39774#define vcreate_bf16(__p0) __extension__ ({ \
39775 bfloat16x4_t __ret; \
39776 uint64_t __promote = __p0; \
39777 __ret = (bfloat16x4_t)(__promote); \
39778 __ret; \
39779})
39780#ifdef __LITTLE_ENDIAN__
39781__ai float32x4_t vcvt_f32_bf16(bfloat16x4_t __p0_150) {
39782 float32x4_t __ret_150;
39783bfloat16x4_t __reint_150 = __p0_150;
39784int32x4_t __reint1_150 = vshll_n_s16(*(int16x4_t *) &__reint_150, 16);
39785 __ret_150 = *(float32x4_t *) &__reint1_150;
39786 return __ret_150;
39787}
39788#else
39789__ai float32x4_t vcvt_f32_bf16(bfloat16x4_t __p0_151) {
39790 float32x4_t __ret_151;
39791 bfloat16x4_t __rev0_151; __rev0_151 = __builtin_shufflevector(__p0_151, __p0_151, 3, 2, 1, 0);
39792bfloat16x4_t __reint_151 = __rev0_151;
39793int32x4_t __reint1_151 = __noswap_vshll_n_s16(*(int16x4_t *) &__reint_151, 16);
39794 __ret_151 = *(float32x4_t *) &__reint1_151;
39795 __ret_151 = __builtin_shufflevector(__ret_151, __ret_151, 3, 2, 1, 0);
39796 return __ret_151;
39797}
39798__ai float32x4_t __noswap_vcvt_f32_bf16(bfloat16x4_t __p0_152) {
39799 float32x4_t __ret_152;
39800bfloat16x4_t __reint_152 = __p0_152;
39801int32x4_t __reint1_152 = __noswap_vshll_n_s16(*(int16x4_t *) &__reint_152, 16);
39802 __ret_152 = *(float32x4_t *) &__reint1_152;
39803 return __ret_152;
39804}
39805#endif
39806
39807__ai float32_t vcvtah_f32_bf16(bfloat16_t __p0) {
41215__ai float32_t vrndns_f32(float32_t __p0) {
3980841216 float32_t __ret;
39809bfloat16_t __reint = __p0;
39810int32_t __reint1 = *(int32_t *) &__reint << 16;
39811 __ret = *(float32_t *) &__reint1;
41217 __ret = (float32_t) __builtin_neon_vrndns_f32(__p0);
3981241218 return __ret;
3981341219}
39814__ai bfloat16_t vcvth_bf16_f32(float32_t __p0) {
39815 bfloat16_t __ret;
39816 __ret = (bfloat16_t) __builtin_neon_vcvth_bf16_f32(__p0);
41220#ifdef __LITTLE_ENDIAN__
41221__ai float32x4_t vrndpq_f32(float32x4_t __p0) {
41222 float32x4_t __ret;
41223 __ret = (float32x4_t) __builtin_neon_vrndpq_v((int8x16_t)__p0, 41);
3981741224 return __ret;
3981841225}
39819#ifdef __LITTLE_ENDIAN__
39820#define vduph_lane_bf16(__p0, __p1) __extension__ ({ \
39821 bfloat16_t __ret; \
39822 bfloat16x4_t __s0 = __p0; \
39823 __ret = (bfloat16_t) __builtin_neon_vduph_lane_bf16((bfloat16x4_t)__s0, __p1); \
39824 __ret; \
39825})
39826#else
39827#define vduph_lane_bf16(__p0, __p1) __extension__ ({ \
39828 bfloat16_t __ret; \
39829 bfloat16x4_t __s0 = __p0; \
39830 bfloat16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
39831 __ret = (bfloat16_t) __builtin_neon_vduph_lane_bf16((bfloat16x4_t)__rev0, __p1); \
39832 __ret; \
39833})
39834#endif
39835
39836#ifdef __LITTLE_ENDIAN__
39837#define vdupq_lane_bf16(__p0_153, __p1_153) __extension__ ({ \
39838 bfloat16x8_t __ret_153; \
39839 bfloat16x4_t __s0_153 = __p0_153; \
39840 __ret_153 = splatq_lane_bf16(__s0_153, __p1_153); \
39841 __ret_153; \
39842})
39843#else
39844#define vdupq_lane_bf16(__p0_154, __p1_154) __extension__ ({ \
39845 bfloat16x8_t __ret_154; \
39846 bfloat16x4_t __s0_154 = __p0_154; \
39847 bfloat16x4_t __rev0_154; __rev0_154 = __builtin_shufflevector(__s0_154, __s0_154, 3, 2, 1, 0); \
39848 __ret_154 = __noswap_splatq_lane_bf16(__rev0_154, __p1_154); \
39849 __ret_154 = __builtin_shufflevector(__ret_154, __ret_154, 7, 6, 5, 4, 3, 2, 1, 0); \
39850 __ret_154; \
39851})
39852#endif
39853
39854#ifdef __LITTLE_ENDIAN__
39855#define vdup_lane_bf16(__p0_155, __p1_155) __extension__ ({ \
39856 bfloat16x4_t __ret_155; \
39857 bfloat16x4_t __s0_155 = __p0_155; \
39858 __ret_155 = splat_lane_bf16(__s0_155, __p1_155); \
39859 __ret_155; \
39860})
3986141226#else
39862#define vdup_lane_bf16(__p0_156, __p1_156) __extension__ ({ \
39863 bfloat16x4_t __ret_156; \
39864 bfloat16x4_t __s0_156 = __p0_156; \
39865 bfloat16x4_t __rev0_156; __rev0_156 = __builtin_shufflevector(__s0_156, __s0_156, 3, 2, 1, 0); \
39866 __ret_156 = __noswap_splat_lane_bf16(__rev0_156, __p1_156); \
39867 __ret_156 = __builtin_shufflevector(__ret_156, __ret_156, 3, 2, 1, 0); \
39868 __ret_156; \
39869})
41227__ai float32x4_t vrndpq_f32(float32x4_t __p0) {
41228 float32x4_t __ret;
41229 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41230 __ret = (float32x4_t) __builtin_neon_vrndpq_v((int8x16_t)__rev0, 41);
41231 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
41232 return __ret;
41233}
3987041234#endif
3987141235
3987241236#ifdef __LITTLE_ENDIAN__
39873#define vduph_laneq_bf16(__p0, __p1) __extension__ ({ \
39874 bfloat16_t __ret; \
39875 bfloat16x8_t __s0 = __p0; \
39876 __ret = (bfloat16_t) __builtin_neon_vduph_laneq_bf16((bfloat16x8_t)__s0, __p1); \
39877 __ret; \
39878})
41237__ai float32x2_t vrndp_f32(float32x2_t __p0) {
41238 float32x2_t __ret;
41239 __ret = (float32x2_t) __builtin_neon_vrndp_v((int8x8_t)__p0, 9);
41240 return __ret;
41241}
3987941242#else
39880#define vduph_laneq_bf16(__p0, __p1) __extension__ ({ \
39881 bfloat16_t __ret; \
39882 bfloat16x8_t __s0 = __p0; \
39883 bfloat16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
39884 __ret = (bfloat16_t) __builtin_neon_vduph_laneq_bf16((bfloat16x8_t)__rev0, __p1); \
39885 __ret; \
39886})
41243__ai float32x2_t vrndp_f32(float32x2_t __p0) {
41244 float32x2_t __ret;
41245 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
41246 __ret = (float32x2_t) __builtin_neon_vrndp_v((int8x8_t)__rev0, 9);
41247 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
41248 return __ret;
41249}
3988741250#endif
3988841251
3988941252#ifdef __LITTLE_ENDIAN__
39890#define vdupq_laneq_bf16(__p0_157, __p1_157) __extension__ ({ \
39891 bfloat16x8_t __ret_157; \
39892 bfloat16x8_t __s0_157 = __p0_157; \
39893 __ret_157 = splatq_laneq_bf16(__s0_157, __p1_157); \
39894 __ret_157; \
39895})
41253__ai float32x4_t vrndxq_f32(float32x4_t __p0) {
41254 float32x4_t __ret;
41255 __ret = (float32x4_t) __builtin_neon_vrndxq_v((int8x16_t)__p0, 41);
41256 return __ret;
41257}
3989641258#else
39897#define vdupq_laneq_bf16(__p0_158, __p1_158) __extension__ ({ \
39898 bfloat16x8_t __ret_158; \
39899 bfloat16x8_t __s0_158 = __p0_158; \
39900 bfloat16x8_t __rev0_158; __rev0_158 = __builtin_shufflevector(__s0_158, __s0_158, 7, 6, 5, 4, 3, 2, 1, 0); \
39901 __ret_158 = __noswap_splatq_laneq_bf16(__rev0_158, __p1_158); \
39902 __ret_158 = __builtin_shufflevector(__ret_158, __ret_158, 7, 6, 5, 4, 3, 2, 1, 0); \
39903 __ret_158; \
39904})
41259__ai float32x4_t vrndxq_f32(float32x4_t __p0) {
41260 float32x4_t __ret;
41261 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41262 __ret = (float32x4_t) __builtin_neon_vrndxq_v((int8x16_t)__rev0, 41);
41263 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
41264 return __ret;
41265}
3990541266#endif
3990641267
3990741268#ifdef __LITTLE_ENDIAN__
39908#define vdup_laneq_bf16(__p0_159, __p1_159) __extension__ ({ \
39909 bfloat16x4_t __ret_159; \
39910 bfloat16x8_t __s0_159 = __p0_159; \
39911 __ret_159 = splat_laneq_bf16(__s0_159, __p1_159); \
39912 __ret_159; \
39913})
41269__ai float32x2_t vrndx_f32(float32x2_t __p0) {
41270 float32x2_t __ret;
41271 __ret = (float32x2_t) __builtin_neon_vrndx_v((int8x8_t)__p0, 9);
41272 return __ret;
41273}
3991441274#else
39915#define vdup_laneq_bf16(__p0_160, __p1_160) __extension__ ({ \
39916 bfloat16x4_t __ret_160; \
39917 bfloat16x8_t __s0_160 = __p0_160; \
39918 bfloat16x8_t __rev0_160; __rev0_160 = __builtin_shufflevector(__s0_160, __s0_160, 7, 6, 5, 4, 3, 2, 1, 0); \
39919 __ret_160 = __noswap_splat_laneq_bf16(__rev0_160, __p1_160); \
39920 __ret_160 = __builtin_shufflevector(__ret_160, __ret_160, 3, 2, 1, 0); \
39921 __ret_160; \
39922})
41275__ai float32x2_t vrndx_f32(float32x2_t __p0) {
41276 float32x2_t __ret;
41277 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
41278 __ret = (float32x2_t) __builtin_neon_vrndx_v((int8x8_t)__rev0, 9);
41279 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
41280 return __ret;
41281}
3992341282#endif
3992441283
3992541284#ifdef __LITTLE_ENDIAN__
39926__ai bfloat16x8_t vdupq_n_bf16(bfloat16_t __p0) {
39927 bfloat16x8_t __ret;
39928 __ret = (bfloat16x8_t) {__p0, __p0, __p0, __p0, __p0, __p0, __p0, __p0};
41285__ai __attribute__((target("fullfp16"))) float16x8_t vrndq_f16(float16x8_t __p0) {
41286 float16x8_t __ret;
41287 __ret = (float16x8_t) __builtin_neon_vrndq_f16((int8x16_t)__p0, 40);
3992941288 return __ret;
3993041289}
3993141290#else
39932__ai bfloat16x8_t vdupq_n_bf16(bfloat16_t __p0) {
39933 bfloat16x8_t __ret;
39934 __ret = (bfloat16x8_t) {__p0, __p0, __p0, __p0, __p0, __p0, __p0, __p0};
41291__ai __attribute__((target("fullfp16"))) float16x8_t vrndq_f16(float16x8_t __p0) {
41292 float16x8_t __ret;
41293 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
41294 __ret = (float16x8_t) __builtin_neon_vrndq_f16((int8x16_t)__rev0, 40);
3993541295 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
3993641296 return __ret;
3993741297}
3993841298#endif
3993941299
3994041300#ifdef __LITTLE_ENDIAN__
39941__ai bfloat16x4_t vdup_n_bf16(bfloat16_t __p0) {
39942 bfloat16x4_t __ret;
39943 __ret = (bfloat16x4_t) {__p0, __p0, __p0, __p0};
41301__ai __attribute__((target("fullfp16"))) float16x4_t vrnd_f16(float16x4_t __p0) {
41302 float16x4_t __ret;
41303 __ret = (float16x4_t) __builtin_neon_vrnd_f16((int8x8_t)__p0, 8);
3994441304 return __ret;
3994541305}
3994641306#else
39947__ai bfloat16x4_t vdup_n_bf16(bfloat16_t __p0) {
39948 bfloat16x4_t __ret;
39949 __ret = (bfloat16x4_t) {__p0, __p0, __p0, __p0};
41307__ai __attribute__((target("fullfp16"))) float16x4_t vrnd_f16(float16x4_t __p0) {
41308 float16x4_t __ret;
41309 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41310 __ret = (float16x4_t) __builtin_neon_vrnd_f16((int8x8_t)__rev0, 8);
3995041311 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
3995141312 return __ret;
3995241313}
3995341314#endif
3995441315
3995541316#ifdef __LITTLE_ENDIAN__
39956__ai bfloat16x4_t vget_high_bf16(bfloat16x8_t __p0) {
39957 bfloat16x4_t __ret;
39958 __ret = __builtin_shufflevector(__p0, __p0, 4, 5, 6, 7);
41317__ai __attribute__((target("fullfp16"))) float16x8_t vrndaq_f16(float16x8_t __p0) {
41318 float16x8_t __ret;
41319 __ret = (float16x8_t) __builtin_neon_vrndaq_f16((int8x16_t)__p0, 40);
3995941320 return __ret;
3996041321}
3996141322#else
39962__ai bfloat16x4_t vget_high_bf16(bfloat16x8_t __p0) {
39963 bfloat16x4_t __ret;
39964 bfloat16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
39965 __ret = __builtin_shufflevector(__rev0, __rev0, 4, 5, 6, 7);
39966 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
39967 return __ret;
39968}
39969__ai bfloat16x4_t __noswap_vget_high_bf16(bfloat16x8_t __p0) {
39970 bfloat16x4_t __ret;
39971 __ret = __builtin_shufflevector(__p0, __p0, 4, 5, 6, 7);
41323__ai __attribute__((target("fullfp16"))) float16x8_t vrndaq_f16(float16x8_t __p0) {
41324 float16x8_t __ret;
41325 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
41326 __ret = (float16x8_t) __builtin_neon_vrndaq_f16((int8x16_t)__rev0, 40);
41327 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
3997241328 return __ret;
3997341329}
3997441330#endif
3997541331
3997641332#ifdef __LITTLE_ENDIAN__
39977#define vgetq_lane_bf16(__p0, __p1) __extension__ ({ \
39978 bfloat16_t __ret; \
39979 bfloat16x8_t __s0 = __p0; \
39980 __ret = (bfloat16_t) __builtin_neon_vgetq_lane_bf16((bfloat16x8_t)__s0, __p1); \
39981 __ret; \
39982})
39983#else
39984#define vgetq_lane_bf16(__p0, __p1) __extension__ ({ \
39985 bfloat16_t __ret; \
39986 bfloat16x8_t __s0 = __p0; \
39987 bfloat16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
39988 __ret = (bfloat16_t) __builtin_neon_vgetq_lane_bf16((bfloat16x8_t)__rev0, __p1); \
39989 __ret; \
39990})
39991#define __noswap_vgetq_lane_bf16(__p0, __p1) __extension__ ({ \
39992 bfloat16_t __ret; \
39993 bfloat16x8_t __s0 = __p0; \
39994 __ret = (bfloat16_t) __builtin_neon_vgetq_lane_bf16((bfloat16x8_t)__s0, __p1); \
39995 __ret; \
39996})
39997#endif
39998
39999#ifdef __LITTLE_ENDIAN__
40000#define vget_lane_bf16(__p0, __p1) __extension__ ({ \
40001 bfloat16_t __ret; \
40002 bfloat16x4_t __s0 = __p0; \
40003 __ret = (bfloat16_t) __builtin_neon_vget_lane_bf16((bfloat16x4_t)__s0, __p1); \
40004 __ret; \
40005})
40006#else
40007#define vget_lane_bf16(__p0, __p1) __extension__ ({ \
40008 bfloat16_t __ret; \
40009 bfloat16x4_t __s0 = __p0; \
40010 bfloat16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
40011 __ret = (bfloat16_t) __builtin_neon_vget_lane_bf16((bfloat16x4_t)__rev0, __p1); \
40012 __ret; \
40013})
40014#define __noswap_vget_lane_bf16(__p0, __p1) __extension__ ({ \
40015 bfloat16_t __ret; \
40016 bfloat16x4_t __s0 = __p0; \
40017 __ret = (bfloat16_t) __builtin_neon_vget_lane_bf16((bfloat16x4_t)__s0, __p1); \
40018 __ret; \
40019})
40020#endif
40021
40022#ifdef __LITTLE_ENDIAN__
40023__ai bfloat16x4_t vget_low_bf16(bfloat16x8_t __p0) {
40024 bfloat16x4_t __ret;
40025 __ret = __builtin_shufflevector(__p0, __p0, 0, 1, 2, 3);
41333__ai __attribute__((target("fullfp16"))) float16x4_t vrnda_f16(float16x4_t __p0) {
41334 float16x4_t __ret;
41335 __ret = (float16x4_t) __builtin_neon_vrnda_f16((int8x8_t)__p0, 8);
4002641336 return __ret;
4002741337}
4002841338#else
40029__ai bfloat16x4_t vget_low_bf16(bfloat16x8_t __p0) {
40030 bfloat16x4_t __ret;
40031 bfloat16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
40032 __ret = __builtin_shufflevector(__rev0, __rev0, 0, 1, 2, 3);
41339__ai __attribute__((target("fullfp16"))) float16x4_t vrnda_f16(float16x4_t __p0) {
41340 float16x4_t __ret;
41341 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41342 __ret = (float16x4_t) __builtin_neon_vrnda_f16((int8x8_t)__rev0, 8);
4003341343 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
4003441344 return __ret;
4003541345}
40036__ai bfloat16x4_t __noswap_vget_low_bf16(bfloat16x8_t __p0) {
40037 bfloat16x4_t __ret;
40038 __ret = __builtin_shufflevector(__p0, __p0, 0, 1, 2, 3);
40039 return __ret;
40040}
40041#endif
40042
40043#ifdef __LITTLE_ENDIAN__
40044#define vld1q_bf16(__p0) __extension__ ({ \
40045 bfloat16x8_t __ret; \
40046 __ret = (bfloat16x8_t) __builtin_neon_vld1q_v(__p0, 43); \
40047 __ret; \
40048})
40049#else
40050#define vld1q_bf16(__p0) __extension__ ({ \
40051 bfloat16x8_t __ret; \
40052 __ret = (bfloat16x8_t) __builtin_neon_vld1q_v(__p0, 43); \
40053 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
40054 __ret; \
40055})
4005641346#endif
4005741347
4005841348#ifdef __LITTLE_ENDIAN__
40059#define vld1_bf16(__p0) __extension__ ({ \
40060 bfloat16x4_t __ret; \
40061 __ret = (bfloat16x4_t) __builtin_neon_vld1_v(__p0, 11); \
40062 __ret; \
40063})
40064#else
40065#define vld1_bf16(__p0) __extension__ ({ \
40066 bfloat16x4_t __ret; \
40067 __ret = (bfloat16x4_t) __builtin_neon_vld1_v(__p0, 11); \
40068 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
40069 __ret; \
40070})
40071#endif
40072
40073#ifdef __LITTLE_ENDIAN__
40074#define vld1q_dup_bf16(__p0) __extension__ ({ \
40075 bfloat16x8_t __ret; \
40076 __ret = (bfloat16x8_t) __builtin_neon_vld1q_dup_v(__p0, 43); \
40077 __ret; \
40078})
40079#else
40080#define vld1q_dup_bf16(__p0) __extension__ ({ \
40081 bfloat16x8_t __ret; \
40082 __ret = (bfloat16x8_t) __builtin_neon_vld1q_dup_v(__p0, 43); \
40083 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
40084 __ret; \
40085})
40086#endif
40087
40088#ifdef __LITTLE_ENDIAN__
40089#define vld1_dup_bf16(__p0) __extension__ ({ \
40090 bfloat16x4_t __ret; \
40091 __ret = (bfloat16x4_t) __builtin_neon_vld1_dup_v(__p0, 11); \
40092 __ret; \
40093})
40094#else
40095#define vld1_dup_bf16(__p0) __extension__ ({ \
40096 bfloat16x4_t __ret; \
40097 __ret = (bfloat16x4_t) __builtin_neon_vld1_dup_v(__p0, 11); \
40098 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
40099 __ret; \
40100})
40101#endif
40102
40103#ifdef __LITTLE_ENDIAN__
40104#define vld1q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40105 bfloat16x8_t __ret; \
40106 bfloat16x8_t __s1 = __p1; \
40107 __ret = (bfloat16x8_t) __builtin_neon_vld1q_lane_v(__p0, (int8x16_t)__s1, __p2, 43); \
40108 __ret; \
40109})
40110#else
40111#define vld1q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40112 bfloat16x8_t __ret; \
40113 bfloat16x8_t __s1 = __p1; \
40114 bfloat16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
40115 __ret = (bfloat16x8_t) __builtin_neon_vld1q_lane_v(__p0, (int8x16_t)__rev1, __p2, 43); \
40116 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
40117 __ret; \
40118})
40119#endif
40120
40121#ifdef __LITTLE_ENDIAN__
40122#define vld1_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40123 bfloat16x4_t __ret; \
40124 bfloat16x4_t __s1 = __p1; \
40125 __ret = (bfloat16x4_t) __builtin_neon_vld1_lane_v(__p0, (int8x8_t)__s1, __p2, 11); \
40126 __ret; \
40127})
41349__ai __attribute__((target("fullfp16"))) float16x8_t vrndmq_f16(float16x8_t __p0) {
41350 float16x8_t __ret;
41351 __ret = (float16x8_t) __builtin_neon_vrndmq_f16((int8x16_t)__p0, 40);
41352 return __ret;
41353}
4012841354#else
40129#define vld1_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40130 bfloat16x4_t __ret; \
40131 bfloat16x4_t __s1 = __p1; \
40132 bfloat16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
40133 __ret = (bfloat16x4_t) __builtin_neon_vld1_lane_v(__p0, (int8x8_t)__rev1, __p2, 11); \
40134 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
40135 __ret; \
40136})
41355__ai __attribute__((target("fullfp16"))) float16x8_t vrndmq_f16(float16x8_t __p0) {
41356 float16x8_t __ret;
41357 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
41358 __ret = (float16x8_t) __builtin_neon_vrndmq_f16((int8x16_t)__rev0, 40);
41359 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
41360 return __ret;
41361}
4013741362#endif
4013841363
4013941364#ifdef __LITTLE_ENDIAN__
40140#define vld1q_bf16_x2(__p0) __extension__ ({ \
40141 bfloat16x8x2_t __ret; \
40142 __builtin_neon_vld1q_x2_v(&__ret, __p0, 43); \
40143 __ret; \
40144})
41365__ai __attribute__((target("fullfp16"))) float16x4_t vrndm_f16(float16x4_t __p0) {
41366 float16x4_t __ret;
41367 __ret = (float16x4_t) __builtin_neon_vrndm_f16((int8x8_t)__p0, 8);
41368 return __ret;
41369}
4014541370#else
40146#define vld1q_bf16_x2(__p0) __extension__ ({ \
40147 bfloat16x8x2_t __ret; \
40148 __builtin_neon_vld1q_x2_v(&__ret, __p0, 43); \
40149 \
40150 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40151 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40152 __ret; \
40153})
41371__ai __attribute__((target("fullfp16"))) float16x4_t vrndm_f16(float16x4_t __p0) {
41372 float16x4_t __ret;
41373 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41374 __ret = (float16x4_t) __builtin_neon_vrndm_f16((int8x8_t)__rev0, 8);
41375 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
41376 return __ret;
41377}
4015441378#endif
4015541379
4015641380#ifdef __LITTLE_ENDIAN__
40157#define vld1_bf16_x2(__p0) __extension__ ({ \
40158 bfloat16x4x2_t __ret; \
40159 __builtin_neon_vld1_x2_v(&__ret, __p0, 11); \
40160 __ret; \
40161})
41381__ai __attribute__((target("fullfp16"))) float16x8_t vrndnq_f16(float16x8_t __p0) {
41382 float16x8_t __ret;
41383 __ret = (float16x8_t) __builtin_neon_vrndnq_f16((int8x16_t)__p0, 40);
41384 return __ret;
41385}
4016241386#else
40163#define vld1_bf16_x2(__p0) __extension__ ({ \
40164 bfloat16x4x2_t __ret; \
40165 __builtin_neon_vld1_x2_v(&__ret, __p0, 11); \
40166 \
40167 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
40168 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
40169 __ret; \
40170})
41387__ai __attribute__((target("fullfp16"))) float16x8_t vrndnq_f16(float16x8_t __p0) {
41388 float16x8_t __ret;
41389 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
41390 __ret = (float16x8_t) __builtin_neon_vrndnq_f16((int8x16_t)__rev0, 40);
41391 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
41392 return __ret;
41393}
4017141394#endif
4017241395
4017341396#ifdef __LITTLE_ENDIAN__
40174#define vld1q_bf16_x3(__p0) __extension__ ({ \
40175 bfloat16x8x3_t __ret; \
40176 __builtin_neon_vld1q_x3_v(&__ret, __p0, 43); \
40177 __ret; \
40178})
41397__ai __attribute__((target("fullfp16"))) float16x4_t vrndn_f16(float16x4_t __p0) {
41398 float16x4_t __ret;
41399 __ret = (float16x4_t) __builtin_neon_vrndn_f16((int8x8_t)__p0, 8);
41400 return __ret;
41401}
4017941402#else
40180#define vld1q_bf16_x3(__p0) __extension__ ({ \
40181 bfloat16x8x3_t __ret; \
40182 __builtin_neon_vld1q_x3_v(&__ret, __p0, 43); \
40183 \
40184 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40185 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40186 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
40187 __ret; \
40188})
41403__ai __attribute__((target("fullfp16"))) float16x4_t vrndn_f16(float16x4_t __p0) {
41404 float16x4_t __ret;
41405 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41406 __ret = (float16x4_t) __builtin_neon_vrndn_f16((int8x8_t)__rev0, 8);
41407 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
41408 return __ret;
41409}
4018941410#endif
4019041411
4019141412#ifdef __LITTLE_ENDIAN__
40192#define vld1_bf16_x3(__p0) __extension__ ({ \
40193 bfloat16x4x3_t __ret; \
40194 __builtin_neon_vld1_x3_v(&__ret, __p0, 11); \
40195 __ret; \
40196})
41413__ai __attribute__((target("fullfp16"))) float16x8_t vrndpq_f16(float16x8_t __p0) {
41414 float16x8_t __ret;
41415 __ret = (float16x8_t) __builtin_neon_vrndpq_f16((int8x16_t)__p0, 40);
41416 return __ret;
41417}
4019741418#else
40198#define vld1_bf16_x3(__p0) __extension__ ({ \
40199 bfloat16x4x3_t __ret; \
40200 __builtin_neon_vld1_x3_v(&__ret, __p0, 11); \
40201 \
40202 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
40203 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
40204 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
40205 __ret; \
40206})
41419__ai __attribute__((target("fullfp16"))) float16x8_t vrndpq_f16(float16x8_t __p0) {
41420 float16x8_t __ret;
41421 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
41422 __ret = (float16x8_t) __builtin_neon_vrndpq_f16((int8x16_t)__rev0, 40);
41423 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
41424 return __ret;
41425}
4020741426#endif
4020841427
4020941428#ifdef __LITTLE_ENDIAN__
40210#define vld1q_bf16_x4(__p0) __extension__ ({ \
40211 bfloat16x8x4_t __ret; \
40212 __builtin_neon_vld1q_x4_v(&__ret, __p0, 43); \
40213 __ret; \
40214})
41429__ai __attribute__((target("fullfp16"))) float16x4_t vrndp_f16(float16x4_t __p0) {
41430 float16x4_t __ret;
41431 __ret = (float16x4_t) __builtin_neon_vrndp_f16((int8x8_t)__p0, 8);
41432 return __ret;
41433}
4021541434#else
40216#define vld1q_bf16_x4(__p0) __extension__ ({ \
40217 bfloat16x8x4_t __ret; \
40218 __builtin_neon_vld1q_x4_v(&__ret, __p0, 43); \
40219 \
40220 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40221 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40222 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
40223 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
40224 __ret; \
40225})
41435__ai __attribute__((target("fullfp16"))) float16x4_t vrndp_f16(float16x4_t __p0) {
41436 float16x4_t __ret;
41437 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41438 __ret = (float16x4_t) __builtin_neon_vrndp_f16((int8x8_t)__rev0, 8);
41439 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
41440 return __ret;
41441}
4022641442#endif
4022741443
4022841444#ifdef __LITTLE_ENDIAN__
40229#define vld1_bf16_x4(__p0) __extension__ ({ \
40230 bfloat16x4x4_t __ret; \
40231 __builtin_neon_vld1_x4_v(&__ret, __p0, 11); \
40232 __ret; \
40233})
41445__ai __attribute__((target("fullfp16"))) float16x8_t vrndxq_f16(float16x8_t __p0) {
41446 float16x8_t __ret;
41447 __ret = (float16x8_t) __builtin_neon_vrndxq_f16((int8x16_t)__p0, 40);
41448 return __ret;
41449}
4023441450#else
40235#define vld1_bf16_x4(__p0) __extension__ ({ \
40236 bfloat16x4x4_t __ret; \
40237 __builtin_neon_vld1_x4_v(&__ret, __p0, 11); \
40238 \
40239 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
40240 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
40241 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
40242 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 3, 2, 1, 0); \
40243 __ret; \
40244})
41451__ai __attribute__((target("fullfp16"))) float16x8_t vrndxq_f16(float16x8_t __p0) {
41452 float16x8_t __ret;
41453 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
41454 __ret = (float16x8_t) __builtin_neon_vrndxq_f16((int8x16_t)__rev0, 40);
41455 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
41456 return __ret;
41457}
4024541458#endif
4024641459
4024741460#ifdef __LITTLE_ENDIAN__
40248#define vld2q_bf16(__p0) __extension__ ({ \
40249 bfloat16x8x2_t __ret; \
40250 __builtin_neon_vld2q_v(&__ret, __p0, 43); \
40251 __ret; \
40252})
41461__ai __attribute__((target("fullfp16"))) float16x4_t vrndx_f16(float16x4_t __p0) {
41462 float16x4_t __ret;
41463 __ret = (float16x4_t) __builtin_neon_vrndx_f16((int8x8_t)__p0, 8);
41464 return __ret;
41465}
4025341466#else
40254#define vld2q_bf16(__p0) __extension__ ({ \
40255 bfloat16x8x2_t __ret; \
40256 __builtin_neon_vld2q_v(&__ret, __p0, 43); \
40257 \
40258 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40259 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40260 __ret; \
40261})
41467__ai __attribute__((target("fullfp16"))) float16x4_t vrndx_f16(float16x4_t __p0) {
41468 float16x4_t __ret;
41469 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41470 __ret = (float16x4_t) __builtin_neon_vrndx_f16((int8x8_t)__rev0, 8);
41471 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
41472 return __ret;
41473}
4026241474#endif
4026341475
41476#endif
41477#if __ARM_ARCH >= 8 && defined(__ARM_FEATURE_NUMERIC_MAXMIN)
4026441478#ifdef __LITTLE_ENDIAN__
40265#define vld2_bf16(__p0) __extension__ ({ \
40266 bfloat16x4x2_t __ret; \
40267 __builtin_neon_vld2_v(&__ret, __p0, 11); \
40268 __ret; \
40269})
41479__ai float32x4_t vmaxnmq_f32(float32x4_t __p0, float32x4_t __p1) {
41480 float32x4_t __ret;
41481 __ret = (float32x4_t) __builtin_neon_vmaxnmq_v((int8x16_t)__p0, (int8x16_t)__p1, 41);
41482 return __ret;
41483}
4027041484#else
40271#define vld2_bf16(__p0) __extension__ ({ \
40272 bfloat16x4x2_t __ret; \
40273 __builtin_neon_vld2_v(&__ret, __p0, 11); \
40274 \
40275 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
40276 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
40277 __ret; \
40278})
41485__ai float32x4_t vmaxnmq_f32(float32x4_t __p0, float32x4_t __p1) {
41486 float32x4_t __ret;
41487 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41488 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
41489 __ret = (float32x4_t) __builtin_neon_vmaxnmq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 41);
41490 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
41491 return __ret;
41492}
4027941493#endif
4028041494
4028141495#ifdef __LITTLE_ENDIAN__
40282#define vld2q_dup_bf16(__p0) __extension__ ({ \
40283 bfloat16x8x2_t __ret; \
40284 __builtin_neon_vld2q_dup_v(&__ret, __p0, 43); \
40285 __ret; \
40286})
41496__ai float32x2_t vmaxnm_f32(float32x2_t __p0, float32x2_t __p1) {
41497 float32x2_t __ret;
41498 __ret = (float32x2_t) __builtin_neon_vmaxnm_v((int8x8_t)__p0, (int8x8_t)__p1, 9);
41499 return __ret;
41500}
4028741501#else
40288#define vld2q_dup_bf16(__p0) __extension__ ({ \
40289 bfloat16x8x2_t __ret; \
40290 __builtin_neon_vld2q_dup_v(&__ret, __p0, 43); \
40291 \
40292 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40293 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40294 __ret; \
40295})
41502__ai float32x2_t vmaxnm_f32(float32x2_t __p0, float32x2_t __p1) {
41503 float32x2_t __ret;
41504 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
41505 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
41506 __ret = (float32x2_t) __builtin_neon_vmaxnm_v((int8x8_t)__rev0, (int8x8_t)__rev1, 9);
41507 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
41508 return __ret;
41509}
4029641510#endif
4029741511
4029841512#ifdef __LITTLE_ENDIAN__
40299#define vld2_dup_bf16(__p0) __extension__ ({ \
40300 bfloat16x4x2_t __ret; \
40301 __builtin_neon_vld2_dup_v(&__ret, __p0, 11); \
40302 __ret; \
40303})
41513__ai float32x4_t vminnmq_f32(float32x4_t __p0, float32x4_t __p1) {
41514 float32x4_t __ret;
41515 __ret = (float32x4_t) __builtin_neon_vminnmq_v((int8x16_t)__p0, (int8x16_t)__p1, 41);
41516 return __ret;
41517}
4030441518#else
40305#define vld2_dup_bf16(__p0) __extension__ ({ \
40306 bfloat16x4x2_t __ret; \
40307 __builtin_neon_vld2_dup_v(&__ret, __p0, 11); \
40308 \
40309 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
40310 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
40311 __ret; \
40312})
41519__ai float32x4_t vminnmq_f32(float32x4_t __p0, float32x4_t __p1) {
41520 float32x4_t __ret;
41521 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41522 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
41523 __ret = (float32x4_t) __builtin_neon_vminnmq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 41);
41524 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
41525 return __ret;
41526}
4031341527#endif
4031441528
4031541529#ifdef __LITTLE_ENDIAN__
40316#define vld2q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40317 bfloat16x8x2_t __ret; \
40318 bfloat16x8x2_t __s1 = __p1; \
40319 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 43); \
40320 __ret; \
40321})
41530__ai float32x2_t vminnm_f32(float32x2_t __p0, float32x2_t __p1) {
41531 float32x2_t __ret;
41532 __ret = (float32x2_t) __builtin_neon_vminnm_v((int8x8_t)__p0, (int8x8_t)__p1, 9);
41533 return __ret;
41534}
4032241535#else
40323#define vld2q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40324 bfloat16x8x2_t __ret; \
40325 bfloat16x8x2_t __s1 = __p1; \
40326 bfloat16x8x2_t __rev1; \
40327 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40328 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40329 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 43); \
40330 \
40331 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40332 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40333 __ret; \
40334})
41536__ai float32x2_t vminnm_f32(float32x2_t __p0, float32x2_t __p1) {
41537 float32x2_t __ret;
41538 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
41539 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
41540 __ret = (float32x2_t) __builtin_neon_vminnm_v((int8x8_t)__rev0, (int8x8_t)__rev1, 9);
41541 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
41542 return __ret;
41543}
4033541544#endif
4033641545
4033741546#ifdef __LITTLE_ENDIAN__
40338#define vld2_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40339 bfloat16x4x2_t __ret; \
40340 bfloat16x4x2_t __s1 = __p1; \
40341 __builtin_neon_vld2_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], __p2, 11); \
40342 __ret; \
40343})
41547__ai __attribute__((target("fullfp16"))) float16x8_t vmaxnmq_f16(float16x8_t __p0, float16x8_t __p1) {
41548 float16x8_t __ret;
41549 __ret = (float16x8_t) __builtin_neon_vmaxnmq_f16((int8x16_t)__p0, (int8x16_t)__p1, 40);
41550 return __ret;
41551}
4034441552#else
40345#define vld2_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40346 bfloat16x4x2_t __ret; \
40347 bfloat16x4x2_t __s1 = __p1; \
40348 bfloat16x4x2_t __rev1; \
40349 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
40350 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
40351 __builtin_neon_vld2_lane_v(&__ret, __p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], __p2, 11); \
40352 \
40353 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
40354 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
40355 __ret; \
40356})
41553__ai __attribute__((target("fullfp16"))) float16x8_t vmaxnmq_f16(float16x8_t __p0, float16x8_t __p1) {
41554 float16x8_t __ret;
41555 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
41556 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
41557 __ret = (float16x8_t) __builtin_neon_vmaxnmq_f16((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
41558 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
41559 return __ret;
41560}
4035741561#endif
4035841562
4035941563#ifdef __LITTLE_ENDIAN__
40360#define vld3q_bf16(__p0) __extension__ ({ \
40361 bfloat16x8x3_t __ret; \
40362 __builtin_neon_vld3q_v(&__ret, __p0, 43); \
40363 __ret; \
40364})
41564__ai __attribute__((target("fullfp16"))) float16x4_t vmaxnm_f16(float16x4_t __p0, float16x4_t __p1) {
41565 float16x4_t __ret;
41566 __ret = (float16x4_t) __builtin_neon_vmaxnm_f16((int8x8_t)__p0, (int8x8_t)__p1, 8);
41567 return __ret;
41568}
4036541569#else
40366#define vld3q_bf16(__p0) __extension__ ({ \
40367 bfloat16x8x3_t __ret; \
40368 __builtin_neon_vld3q_v(&__ret, __p0, 43); \
40369 \
40370 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40371 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40372 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
40373 __ret; \
40374})
41570__ai __attribute__((target("fullfp16"))) float16x4_t vmaxnm_f16(float16x4_t __p0, float16x4_t __p1) {
41571 float16x4_t __ret;
41572 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41573 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
41574 __ret = (float16x4_t) __builtin_neon_vmaxnm_f16((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
41575 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
41576 return __ret;
41577}
4037541578#endif
4037641579
4037741580#ifdef __LITTLE_ENDIAN__
40378#define vld3_bf16(__p0) __extension__ ({ \
40379 bfloat16x4x3_t __ret; \
40380 __builtin_neon_vld3_v(&__ret, __p0, 11); \
40381 __ret; \
40382})
41581__ai __attribute__((target("fullfp16"))) float16x8_t vminnmq_f16(float16x8_t __p0, float16x8_t __p1) {
41582 float16x8_t __ret;
41583 __ret = (float16x8_t) __builtin_neon_vminnmq_f16((int8x16_t)__p0, (int8x16_t)__p1, 40);
41584 return __ret;
41585}
4038341586#else
40384#define vld3_bf16(__p0) __extension__ ({ \
40385 bfloat16x4x3_t __ret; \
40386 __builtin_neon_vld3_v(&__ret, __p0, 11); \
40387 \
40388 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
40389 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
40390 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
40391 __ret; \
40392})
41587__ai __attribute__((target("fullfp16"))) float16x8_t vminnmq_f16(float16x8_t __p0, float16x8_t __p1) {
41588 float16x8_t __ret;
41589 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
41590 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
41591 __ret = (float16x8_t) __builtin_neon_vminnmq_f16((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
41592 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
41593 return __ret;
41594}
4039341595#endif
4039441596
4039541597#ifdef __LITTLE_ENDIAN__
40396#define vld3q_dup_bf16(__p0) __extension__ ({ \
40397 bfloat16x8x3_t __ret; \
40398 __builtin_neon_vld3q_dup_v(&__ret, __p0, 43); \
40399 __ret; \
40400})
41598__ai __attribute__((target("fullfp16"))) float16x4_t vminnm_f16(float16x4_t __p0, float16x4_t __p1) {
41599 float16x4_t __ret;
41600 __ret = (float16x4_t) __builtin_neon_vminnm_f16((int8x8_t)__p0, (int8x8_t)__p1, 8);
41601 return __ret;
41602}
4040141603#else
40402#define vld3q_dup_bf16(__p0) __extension__ ({ \
40403 bfloat16x8x3_t __ret; \
40404 __builtin_neon_vld3q_dup_v(&__ret, __p0, 43); \
40405 \
40406 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40407 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40408 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
40409 __ret; \
40410})
41604__ai __attribute__((target("fullfp16"))) float16x4_t vminnm_f16(float16x4_t __p0, float16x4_t __p1) {
41605 float16x4_t __ret;
41606 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41607 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
41608 __ret = (float16x4_t) __builtin_neon_vminnm_f16((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
41609 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
41610 return __ret;
41611}
4041141612#endif
4041241613
41614#endif
41615#if defined(__ARM_FEATURE_FMA)
4041341616#ifdef __LITTLE_ENDIAN__
40414#define vld3_dup_bf16(__p0) __extension__ ({ \
40415 bfloat16x4x3_t __ret; \
40416 __builtin_neon_vld3_dup_v(&__ret, __p0, 11); \
40417 __ret; \
40418})
41617__ai float32x4_t vfmaq_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
41618 float32x4_t __ret;
41619 __ret = (float32x4_t) __builtin_neon_vfmaq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
41620 return __ret;
41621}
4041941622#else
40420#define vld3_dup_bf16(__p0) __extension__ ({ \
40421 bfloat16x4x3_t __ret; \
40422 __builtin_neon_vld3_dup_v(&__ret, __p0, 11); \
40423 \
40424 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
40425 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
40426 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
40427 __ret; \
40428})
41623__ai float32x4_t vfmaq_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
41624 float32x4_t __ret;
41625 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41626 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
41627 float32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
41628 __ret = (float32x4_t) __builtin_neon_vfmaq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 41);
41629 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
41630 return __ret;
41631}
41632__ai float32x4_t __noswap_vfmaq_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
41633 float32x4_t __ret;
41634 __ret = (float32x4_t) __builtin_neon_vfmaq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
41635 return __ret;
41636}
4042941637#endif
4043041638
4043141639#ifdef __LITTLE_ENDIAN__
40432#define vld3q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40433 bfloat16x8x3_t __ret; \
40434 bfloat16x8x3_t __s1 = __p1; \
40435 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 43); \
40436 __ret; \
40437})
41640__ai float32x2_t vfma_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
41641 float32x2_t __ret;
41642 __ret = (float32x2_t) __builtin_neon_vfma_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
41643 return __ret;
41644}
4043841645#else
40439#define vld3q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40440 bfloat16x8x3_t __ret; \
40441 bfloat16x8x3_t __s1 = __p1; \
40442 bfloat16x8x3_t __rev1; \
40443 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40444 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40445 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
40446 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 43); \
40447 \
40448 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40449 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40450 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
40451 __ret; \
40452})
41646__ai float32x2_t vfma_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
41647 float32x2_t __ret;
41648 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
41649 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
41650 float32x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
41651 __ret = (float32x2_t) __builtin_neon_vfma_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 9);
41652 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
41653 return __ret;
41654}
41655__ai float32x2_t __noswap_vfma_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
41656 float32x2_t __ret;
41657 __ret = (float32x2_t) __builtin_neon_vfma_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
41658 return __ret;
41659}
4045341660#endif
4045441661
4045541662#ifdef __LITTLE_ENDIAN__
40456#define vld3_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40457 bfloat16x4x3_t __ret; \
40458 bfloat16x4x3_t __s1 = __p1; \
40459 __builtin_neon_vld3_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], __p2, 11); \
40460 __ret; \
40461})
41663__ai float32x4_t vfmaq_n_f32(float32x4_t __p0, float32x4_t __p1, float32_t __p2) {
41664 float32x4_t __ret;
41665 __ret = vfmaq_f32(__p0, __p1, (float32x4_t) {__p2, __p2, __p2, __p2});
41666 return __ret;
41667}
4046241668#else
40463#define vld3_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40464 bfloat16x4x3_t __ret; \
40465 bfloat16x4x3_t __s1 = __p1; \
40466 bfloat16x4x3_t __rev1; \
40467 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
40468 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
40469 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
40470 __builtin_neon_vld3_lane_v(&__ret, __p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], __p2, 11); \
40471 \
40472 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
40473 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
40474 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
40475 __ret; \
40476})
41669__ai float32x4_t vfmaq_n_f32(float32x4_t __p0, float32x4_t __p1, float32_t __p2) {
41670 float32x4_t __ret;
41671 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41672 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
41673 __ret = __noswap_vfmaq_f32(__rev0, __rev1, (float32x4_t) {__p2, __p2, __p2, __p2});
41674 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
41675 return __ret;
41676}
4047741677#endif
4047841678
4047941679#ifdef __LITTLE_ENDIAN__
40480#define vld4q_bf16(__p0) __extension__ ({ \
40481 bfloat16x8x4_t __ret; \
40482 __builtin_neon_vld4q_v(&__ret, __p0, 43); \
40483 __ret; \
40484})
41680__ai float32x2_t vfma_n_f32(float32x2_t __p0, float32x2_t __p1, float32_t __p2) {
41681 float32x2_t __ret;
41682 __ret = vfma_f32(__p0, __p1, (float32x2_t) {__p2, __p2});
41683 return __ret;
41684}
4048541685#else
40486#define vld4q_bf16(__p0) __extension__ ({ \
40487 bfloat16x8x4_t __ret; \
40488 __builtin_neon_vld4q_v(&__ret, __p0, 43); \
40489 \
40490 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40491 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40492 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
40493 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
40494 __ret; \
40495})
41686__ai float32x2_t vfma_n_f32(float32x2_t __p0, float32x2_t __p1, float32_t __p2) {
41687 float32x2_t __ret;
41688 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
41689 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
41690 __ret = __noswap_vfma_f32(__rev0, __rev1, (float32x2_t) {__p2, __p2});
41691 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
41692 return __ret;
41693}
4049641694#endif
4049741695
4049841696#ifdef __LITTLE_ENDIAN__
40499#define vld4_bf16(__p0) __extension__ ({ \
40500 bfloat16x4x4_t __ret; \
40501 __builtin_neon_vld4_v(&__ret, __p0, 11); \
40502 __ret; \
40503})
41697__ai float32x4_t vfmsq_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
41698 float32x4_t __ret;
41699 __ret = vfmaq_f32(__p0, -__p1, __p2);
41700 return __ret;
41701}
4050441702#else
40505#define vld4_bf16(__p0) __extension__ ({ \
40506 bfloat16x4x4_t __ret; \
40507 __builtin_neon_vld4_v(&__ret, __p0, 11); \
40508 \
40509 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
40510 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
40511 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
40512 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 3, 2, 1, 0); \
40513 __ret; \
40514})
41703__ai float32x4_t vfmsq_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
41704 float32x4_t __ret;
41705 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41706 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
41707 float32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
41708 __ret = __noswap_vfmaq_f32(__rev0, -__rev1, __rev2);
41709 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
41710 return __ret;
41711}
4051541712#endif
4051641713
4051741714#ifdef __LITTLE_ENDIAN__
40518#define vld4q_dup_bf16(__p0) __extension__ ({ \
40519 bfloat16x8x4_t __ret; \
40520 __builtin_neon_vld4q_dup_v(&__ret, __p0, 43); \
40521 __ret; \
40522})
41715__ai float32x2_t vfms_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
41716 float32x2_t __ret;
41717 __ret = vfma_f32(__p0, -__p1, __p2);
41718 return __ret;
41719}
4052341720#else
40524#define vld4q_dup_bf16(__p0) __extension__ ({ \
40525 bfloat16x8x4_t __ret; \
40526 __builtin_neon_vld4q_dup_v(&__ret, __p0, 43); \
40527 \
40528 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40529 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40530 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
40531 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
40532 __ret; \
40533})
41721__ai float32x2_t vfms_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
41722 float32x2_t __ret;
41723 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
41724 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
41725 float32x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
41726 __ret = __noswap_vfma_f32(__rev0, -__rev1, __rev2);
41727 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
41728 return __ret;
41729}
4053441730#endif
4053541731
41732#endif
41733#if defined(__aarch64__)
4053641734#ifdef __LITTLE_ENDIAN__
40537#define vld4_dup_bf16(__p0) __extension__ ({ \
40538 bfloat16x4x4_t __ret; \
40539 __builtin_neon_vld4_dup_v(&__ret, __p0, 11); \
40540 __ret; \
40541})
41735__ai float64x2_t vabdq_f64(float64x2_t __p0, float64x2_t __p1) {
41736 float64x2_t __ret;
41737 __ret = (float64x2_t) __builtin_neon_vabdq_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
41738 return __ret;
41739}
4054241740#else
40543#define vld4_dup_bf16(__p0) __extension__ ({ \
40544 bfloat16x4x4_t __ret; \
40545 __builtin_neon_vld4_dup_v(&__ret, __p0, 11); \
40546 \
40547 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
40548 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
40549 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
40550 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 3, 2, 1, 0); \
40551 __ret; \
40552})
41741__ai float64x2_t vabdq_f64(float64x2_t __p0, float64x2_t __p1) {
41742 float64x2_t __ret;
41743 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
41744 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
41745 __ret = (float64x2_t) __builtin_neon_vabdq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
41746 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
41747 return __ret;
41748}
4055341749#endif
4055441750
41751__ai float64x1_t vabd_f64(float64x1_t __p0, float64x1_t __p1) {
41752 float64x1_t __ret;
41753 __ret = (float64x1_t) __builtin_neon_vabd_v((int8x8_t)__p0, (int8x8_t)__p1, 10);
41754 return __ret;
41755}
41756__ai float64_t vabdd_f64(float64_t __p0, float64_t __p1) {
41757 float64_t __ret;
41758 __ret = (float64_t) __builtin_neon_vabdd_f64(__p0, __p1);
41759 return __ret;
41760}
41761__ai float32_t vabds_f32(float32_t __p0, float32_t __p1) {
41762 float32_t __ret;
41763 __ret = (float32_t) __builtin_neon_vabds_f32(__p0, __p1);
41764 return __ret;
41765}
4055541766#ifdef __LITTLE_ENDIAN__
40556#define vld4q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40557 bfloat16x8x4_t __ret; \
40558 bfloat16x8x4_t __s1 = __p1; \
40559 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 43); \
40560 __ret; \
40561})
41767__ai float64x2_t vabsq_f64(float64x2_t __p0) {
41768 float64x2_t __ret;
41769 __ret = (float64x2_t) __builtin_neon_vabsq_v((int8x16_t)__p0, 42);
41770 return __ret;
41771}
4056241772#else
40563#define vld4q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40564 bfloat16x8x4_t __ret; \
40565 bfloat16x8x4_t __s1 = __p1; \
40566 bfloat16x8x4_t __rev1; \
40567 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40568 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40569 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
40570 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
40571 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 43); \
40572 \
40573 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40574 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40575 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
40576 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
40577 __ret; \
40578})
41773__ai float64x2_t vabsq_f64(float64x2_t __p0) {
41774 float64x2_t __ret;
41775 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
41776 __ret = (float64x2_t) __builtin_neon_vabsq_v((int8x16_t)__rev0, 42);
41777 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
41778 return __ret;
41779}
4057941780#endif
4058041781
4058141782#ifdef __LITTLE_ENDIAN__
40582#define vld4_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40583 bfloat16x4x4_t __ret; \
40584 bfloat16x4x4_t __s1 = __p1; \
40585 __builtin_neon_vld4_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], __p2, 11); \
40586 __ret; \
40587})
41783__ai int64x2_t vabsq_s64(int64x2_t __p0) {
41784 int64x2_t __ret;
41785 __ret = (int64x2_t) __builtin_neon_vabsq_v((int8x16_t)__p0, 35);
41786 return __ret;
41787}
4058841788#else
40589#define vld4_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40590 bfloat16x4x4_t __ret; \
40591 bfloat16x4x4_t __s1 = __p1; \
40592 bfloat16x4x4_t __rev1; \
40593 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
40594 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
40595 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
40596 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 3, 2, 1, 0); \
40597 __builtin_neon_vld4_lane_v(&__ret, __p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], (int8x8_t)__rev1.val[3], __p2, 11); \
40598 \
40599 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0); \
40600 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0); \
40601 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 3, 2, 1, 0); \
40602 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 3, 2, 1, 0); \
40603 __ret; \
40604})
41789__ai int64x2_t vabsq_s64(int64x2_t __p0) {
41790 int64x2_t __ret;
41791 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
41792 __ret = (int64x2_t) __builtin_neon_vabsq_v((int8x16_t)__rev0, 35);
41793 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
41794 return __ret;
41795}
4060541796#endif
4060641797
41798__ai float64x1_t vabs_f64(float64x1_t __p0) {
41799 float64x1_t __ret;
41800 __ret = (float64x1_t) __builtin_neon_vabs_v((int8x8_t)__p0, 10);
41801 return __ret;
41802}
41803__ai int64x1_t vabs_s64(int64x1_t __p0) {
41804 int64x1_t __ret;
41805 __ret = (int64x1_t) __builtin_neon_vabs_v((int8x8_t)__p0, 3);
41806 return __ret;
41807}
41808__ai int64_t vabsd_s64(int64_t __p0) {
41809 int64_t __ret;
41810 __ret = (int64_t) __builtin_neon_vabsd_s64(__p0);
41811 return __ret;
41812}
4060741813#ifdef __LITTLE_ENDIAN__
40608#define vsetq_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40609 bfloat16x8_t __ret; \
40610 bfloat16_t __s0 = __p0; \
40611 bfloat16x8_t __s1 = __p1; \
40612 __ret = (bfloat16x8_t) __builtin_neon_vsetq_lane_bf16(__s0, (bfloat16x8_t)__s1, __p2); \
40613 __ret; \
40614})
41814__ai float64x2_t vaddq_f64(float64x2_t __p0, float64x2_t __p1) {
41815 float64x2_t __ret;
41816 __ret = __p0 + __p1;
41817 return __ret;
41818}
4061541819#else
40616#define vsetq_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40617 bfloat16x8_t __ret; \
40618 bfloat16_t __s0 = __p0; \
40619 bfloat16x8_t __s1 = __p1; \
40620 bfloat16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
40621 __ret = (bfloat16x8_t) __builtin_neon_vsetq_lane_bf16(__s0, (bfloat16x8_t)__rev1, __p2); \
40622 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
40623 __ret; \
40624})
40625#define __noswap_vsetq_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40626 bfloat16x8_t __ret; \
40627 bfloat16_t __s0 = __p0; \
40628 bfloat16x8_t __s1 = __p1; \
40629 __ret = (bfloat16x8_t) __builtin_neon_vsetq_lane_bf16(__s0, (bfloat16x8_t)__s1, __p2); \
40630 __ret; \
40631})
41820__ai float64x2_t vaddq_f64(float64x2_t __p0, float64x2_t __p1) {
41821 float64x2_t __ret;
41822 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
41823 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
41824 __ret = __rev0 + __rev1;
41825 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
41826 return __ret;
41827}
4063241828#endif
4063341829
41830__ai float64x1_t vadd_f64(float64x1_t __p0, float64x1_t __p1) {
41831 float64x1_t __ret;
41832 __ret = __p0 + __p1;
41833 return __ret;
41834}
41835__ai uint64_t vaddd_u64(uint64_t __p0, uint64_t __p1) {
41836 uint64_t __ret;
41837 __ret = (uint64_t) __builtin_neon_vaddd_u64(__p0, __p1);
41838 return __ret;
41839}
41840__ai int64_t vaddd_s64(int64_t __p0, int64_t __p1) {
41841 int64_t __ret;
41842 __ret = (int64_t) __builtin_neon_vaddd_s64(__p0, __p1);
41843 return __ret;
41844}
41845__ai poly128_t vaddq_p128(poly128_t __p0, poly128_t __p1) {
41846 poly128_t __ret;
41847 __ret = (poly128_t) __builtin_neon_vaddq_p128(__p0, __p1);
41848 return __ret;
41849}
4063441850#ifdef __LITTLE_ENDIAN__
40635#define vset_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40636 bfloat16x4_t __ret; \
40637 bfloat16_t __s0 = __p0; \
40638 bfloat16x4_t __s1 = __p1; \
40639 __ret = (bfloat16x4_t) __builtin_neon_vset_lane_bf16(__s0, (bfloat16x4_t)__s1, __p2); \
40640 __ret; \
40641})
41851__ai uint16x8_t vaddhn_high_u32(uint16x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
41852 uint16x8_t __ret;
41853 __ret = vcombine_u16(__p0, vaddhn_u32(__p1, __p2));
41854 return __ret;
41855}
4064241856#else
40643#define vset_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40644 bfloat16x4_t __ret; \
40645 bfloat16_t __s0 = __p0; \
40646 bfloat16x4_t __s1 = __p1; \
40647 bfloat16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
40648 __ret = (bfloat16x4_t) __builtin_neon_vset_lane_bf16(__s0, (bfloat16x4_t)__rev1, __p2); \
40649 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
40650 __ret; \
40651})
40652#define __noswap_vset_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40653 bfloat16x4_t __ret; \
40654 bfloat16_t __s0 = __p0; \
40655 bfloat16x4_t __s1 = __p1; \
40656 __ret = (bfloat16x4_t) __builtin_neon_vset_lane_bf16(__s0, (bfloat16x4_t)__s1, __p2); \
40657 __ret; \
40658})
41857__ai uint16x8_t vaddhn_high_u32(uint16x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
41858 uint16x8_t __ret;
41859 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41860 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
41861 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
41862 __ret = __noswap_vcombine_u16(__rev0, __noswap_vaddhn_u32(__rev1, __rev2));
41863 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
41864 return __ret;
41865}
4065941866#endif
4066041867
4066141868#ifdef __LITTLE_ENDIAN__
40662#define vst1q_bf16(__p0, __p1) __extension__ ({ \
40663 bfloat16x8_t __s1 = __p1; \
40664 __builtin_neon_vst1q_v(__p0, (int8x16_t)__s1, 43); \
40665})
41869__ai uint32x4_t vaddhn_high_u64(uint32x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
41870 uint32x4_t __ret;
41871 __ret = vcombine_u32(__p0, vaddhn_u64(__p1, __p2));
41872 return __ret;
41873}
4066641874#else
40667#define vst1q_bf16(__p0, __p1) __extension__ ({ \
40668 bfloat16x8_t __s1 = __p1; \
40669 bfloat16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
40670 __builtin_neon_vst1q_v(__p0, (int8x16_t)__rev1, 43); \
40671})
41875__ai uint32x4_t vaddhn_high_u64(uint32x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
41876 uint32x4_t __ret;
41877 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
41878 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
41879 uint64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
41880 __ret = __noswap_vcombine_u32(__rev0, __noswap_vaddhn_u64(__rev1, __rev2));
41881 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
41882 return __ret;
41883}
4067241884#endif
4067341885
4067441886#ifdef __LITTLE_ENDIAN__
40675#define vst1_bf16(__p0, __p1) __extension__ ({ \
40676 bfloat16x4_t __s1 = __p1; \
40677 __builtin_neon_vst1_v(__p0, (int8x8_t)__s1, 11); \
40678})
41887__ai uint8x16_t vaddhn_high_u16(uint8x8_t __p0, uint16x8_t __p1, uint16x8_t __p2) {
41888 uint8x16_t __ret;
41889 __ret = vcombine_u8(__p0, vaddhn_u16(__p1, __p2));
41890 return __ret;
41891}
4067941892#else
40680#define vst1_bf16(__p0, __p1) __extension__ ({ \
40681 bfloat16x4_t __s1 = __p1; \
40682 bfloat16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
40683 __builtin_neon_vst1_v(__p0, (int8x8_t)__rev1, 11); \
40684})
41893__ai uint8x16_t vaddhn_high_u16(uint8x8_t __p0, uint16x8_t __p1, uint16x8_t __p2) {
41894 uint8x16_t __ret;
41895 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
41896 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
41897 uint16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
41898 __ret = __noswap_vcombine_u8(__rev0, __noswap_vaddhn_u16(__rev1, __rev2));
41899 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
41900 return __ret;
41901}
4068541902#endif
4068641903
4068741904#ifdef __LITTLE_ENDIAN__
40688#define vst1q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40689 bfloat16x8_t __s1 = __p1; \
40690 __builtin_neon_vst1q_lane_v(__p0, (int8x16_t)__s1, __p2, 43); \
40691})
41905__ai int16x8_t vaddhn_high_s32(int16x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
41906 int16x8_t __ret;
41907 __ret = vcombine_s16(__p0, vaddhn_s32(__p1, __p2));
41908 return __ret;
41909}
4069241910#else
40693#define vst1q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40694 bfloat16x8_t __s1 = __p1; \
40695 bfloat16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
40696 __builtin_neon_vst1q_lane_v(__p0, (int8x16_t)__rev1, __p2, 43); \
40697})
41911__ai int16x8_t vaddhn_high_s32(int16x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
41912 int16x8_t __ret;
41913 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41914 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
41915 int32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
41916 __ret = __noswap_vcombine_s16(__rev0, __noswap_vaddhn_s32(__rev1, __rev2));
41917 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
41918 return __ret;
41919}
4069841920#endif
4069941921
4070041922#ifdef __LITTLE_ENDIAN__
40701#define vst1_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40702 bfloat16x4_t __s1 = __p1; \
40703 __builtin_neon_vst1_lane_v(__p0, (int8x8_t)__s1, __p2, 11); \
40704})
41923__ai int32x4_t vaddhn_high_s64(int32x2_t __p0, int64x2_t __p1, int64x2_t __p2) {
41924 int32x4_t __ret;
41925 __ret = vcombine_s32(__p0, vaddhn_s64(__p1, __p2));
41926 return __ret;
41927}
4070541928#else
40706#define vst1_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40707 bfloat16x4_t __s1 = __p1; \
40708 bfloat16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
40709 __builtin_neon_vst1_lane_v(__p0, (int8x8_t)__rev1, __p2, 11); \
40710})
41929__ai int32x4_t vaddhn_high_s64(int32x2_t __p0, int64x2_t __p1, int64x2_t __p2) {
41930 int32x4_t __ret;
41931 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
41932 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
41933 int64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
41934 __ret = __noswap_vcombine_s32(__rev0, __noswap_vaddhn_s64(__rev1, __rev2));
41935 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
41936 return __ret;
41937}
4071141938#endif
4071241939
4071341940#ifdef __LITTLE_ENDIAN__
40714#define vst1q_bf16_x2(__p0, __p1) __extension__ ({ \
40715 bfloat16x8x2_t __s1 = __p1; \
40716 __builtin_neon_vst1q_x2_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], 43); \
40717})
41941__ai int8x16_t vaddhn_high_s16(int8x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
41942 int8x16_t __ret;
41943 __ret = vcombine_s8(__p0, vaddhn_s16(__p1, __p2));
41944 return __ret;
41945}
4071841946#else
40719#define vst1q_bf16_x2(__p0, __p1) __extension__ ({ \
40720 bfloat16x8x2_t __s1 = __p1; \
40721 bfloat16x8x2_t __rev1; \
40722 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40723 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40724 __builtin_neon_vst1q_x2_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], 43); \
40725})
41947__ai int8x16_t vaddhn_high_s16(int8x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
41948 int8x16_t __ret;
41949 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
41950 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
41951 int16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
41952 __ret = __noswap_vcombine_s8(__rev0, __noswap_vaddhn_s16(__rev1, __rev2));
41953 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
41954 return __ret;
41955}
4072641956#endif
4072741957
4072841958#ifdef __LITTLE_ENDIAN__
40729#define vst1_bf16_x2(__p0, __p1) __extension__ ({ \
40730 bfloat16x4x2_t __s1 = __p1; \
40731 __builtin_neon_vst1_x2_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], 11); \
40732})
41959__ai uint16_t vaddlvq_u8(uint8x16_t __p0) {
41960 uint16_t __ret;
41961 __ret = (uint16_t) __builtin_neon_vaddlvq_u8(__p0);
41962 return __ret;
41963}
4073341964#else
40734#define vst1_bf16_x2(__p0, __p1) __extension__ ({ \
40735 bfloat16x4x2_t __s1 = __p1; \
40736 bfloat16x4x2_t __rev1; \
40737 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
40738 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
40739 __builtin_neon_vst1_x2_v(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], 11); \
40740})
41965__ai uint16_t vaddlvq_u8(uint8x16_t __p0) {
41966 uint16_t __ret;
41967 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
41968 __ret = (uint16_t) __builtin_neon_vaddlvq_u8(__rev0);
41969 return __ret;
41970}
4074141971#endif
4074241972
4074341973#ifdef __LITTLE_ENDIAN__
40744#define vst1q_bf16_x3(__p0, __p1) __extension__ ({ \
40745 bfloat16x8x3_t __s1 = __p1; \
40746 __builtin_neon_vst1q_x3_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], 43); \
40747})
41974__ai uint64_t vaddlvq_u32(uint32x4_t __p0) {
41975 uint64_t __ret;
41976 __ret = (uint64_t) __builtin_neon_vaddlvq_u32(__p0);
41977 return __ret;
41978}
4074841979#else
40749#define vst1q_bf16_x3(__p0, __p1) __extension__ ({ \
40750 bfloat16x8x3_t __s1 = __p1; \
40751 bfloat16x8x3_t __rev1; \
40752 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40753 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40754 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
40755 __builtin_neon_vst1q_x3_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], 43); \
40756})
41980__ai uint64_t vaddlvq_u32(uint32x4_t __p0) {
41981 uint64_t __ret;
41982 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41983 __ret = (uint64_t) __builtin_neon_vaddlvq_u32(__rev0);
41984 return __ret;
41985}
4075741986#endif
4075841987
4075941988#ifdef __LITTLE_ENDIAN__
40760#define vst1_bf16_x3(__p0, __p1) __extension__ ({ \
40761 bfloat16x4x3_t __s1 = __p1; \
40762 __builtin_neon_vst1_x3_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], 11); \
40763})
41989__ai uint32_t vaddlvq_u16(uint16x8_t __p0) {
41990 uint32_t __ret;
41991 __ret = (uint32_t) __builtin_neon_vaddlvq_u16(__p0);
41992 return __ret;
41993}
4076441994#else
40765#define vst1_bf16_x3(__p0, __p1) __extension__ ({ \
40766 bfloat16x4x3_t __s1 = __p1; \
40767 bfloat16x4x3_t __rev1; \
40768 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
40769 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
40770 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
40771 __builtin_neon_vst1_x3_v(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], 11); \
40772})
41995__ai uint32_t vaddlvq_u16(uint16x8_t __p0) {
41996 uint32_t __ret;
41997 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
41998 __ret = (uint32_t) __builtin_neon_vaddlvq_u16(__rev0);
41999 return __ret;
42000}
4077342001#endif
4077442002
4077542003#ifdef __LITTLE_ENDIAN__
40776#define vst1q_bf16_x4(__p0, __p1) __extension__ ({ \
40777 bfloat16x8x4_t __s1 = __p1; \
40778 __builtin_neon_vst1q_x4_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], 43); \
40779})
42004__ai int16_t vaddlvq_s8(int8x16_t __p0) {
42005 int16_t __ret;
42006 __ret = (int16_t) __builtin_neon_vaddlvq_s8(__p0);
42007 return __ret;
42008}
4078042009#else
40781#define vst1q_bf16_x4(__p0, __p1) __extension__ ({ \
40782 bfloat16x8x4_t __s1 = __p1; \
40783 bfloat16x8x4_t __rev1; \
40784 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40785 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40786 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
40787 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
40788 __builtin_neon_vst1q_x4_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], 43); \
40789})
42010__ai int16_t vaddlvq_s8(int8x16_t __p0) {
42011 int16_t __ret;
42012 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
42013 __ret = (int16_t) __builtin_neon_vaddlvq_s8(__rev0);
42014 return __ret;
42015}
4079042016#endif
4079142017
4079242018#ifdef __LITTLE_ENDIAN__
40793#define vst1_bf16_x4(__p0, __p1) __extension__ ({ \
40794 bfloat16x4x4_t __s1 = __p1; \
40795 __builtin_neon_vst1_x4_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], 11); \
40796})
42019__ai int64_t vaddlvq_s32(int32x4_t __p0) {
42020 int64_t __ret;
42021 __ret = (int64_t) __builtin_neon_vaddlvq_s32(__p0);
42022 return __ret;
42023}
4079742024#else
40798#define vst1_bf16_x4(__p0, __p1) __extension__ ({ \
40799 bfloat16x4x4_t __s1 = __p1; \
40800 bfloat16x4x4_t __rev1; \
40801 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
40802 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
40803 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
40804 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 3, 2, 1, 0); \
40805 __builtin_neon_vst1_x4_v(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], (int8x8_t)__rev1.val[3], 11); \
40806})
42025__ai int64_t vaddlvq_s32(int32x4_t __p0) {
42026 int64_t __ret;
42027 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
42028 __ret = (int64_t) __builtin_neon_vaddlvq_s32(__rev0);
42029 return __ret;
42030}
4080742031#endif
4080842032
4080942033#ifdef __LITTLE_ENDIAN__
40810#define vst2q_bf16(__p0, __p1) __extension__ ({ \
40811 bfloat16x8x2_t __s1 = __p1; \
40812 __builtin_neon_vst2q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], 43); \
40813})
42034__ai int32_t vaddlvq_s16(int16x8_t __p0) {
42035 int32_t __ret;
42036 __ret = (int32_t) __builtin_neon_vaddlvq_s16(__p0);
42037 return __ret;
42038}
4081442039#else
40815#define vst2q_bf16(__p0, __p1) __extension__ ({ \
40816 bfloat16x8x2_t __s1 = __p1; \
40817 bfloat16x8x2_t __rev1; \
40818 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40819 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40820 __builtin_neon_vst2q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], 43); \
40821})
42040__ai int32_t vaddlvq_s16(int16x8_t __p0) {
42041 int32_t __ret;
42042 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
42043 __ret = (int32_t) __builtin_neon_vaddlvq_s16(__rev0);
42044 return __ret;
42045}
4082242046#endif
4082342047
4082442048#ifdef __LITTLE_ENDIAN__
40825#define vst2_bf16(__p0, __p1) __extension__ ({ \
40826 bfloat16x4x2_t __s1 = __p1; \
40827 __builtin_neon_vst2_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], 11); \
40828})
42049__ai uint16_t vaddlv_u8(uint8x8_t __p0) {
42050 uint16_t __ret;
42051 __ret = (uint16_t) __builtin_neon_vaddlv_u8(__p0);
42052 return __ret;
42053}
4082942054#else
40830#define vst2_bf16(__p0, __p1) __extension__ ({ \
40831 bfloat16x4x2_t __s1 = __p1; \
40832 bfloat16x4x2_t __rev1; \
40833 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
40834 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
40835 __builtin_neon_vst2_v(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], 11); \
40836})
42055__ai uint16_t vaddlv_u8(uint8x8_t __p0) {
42056 uint16_t __ret;
42057 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
42058 __ret = (uint16_t) __builtin_neon_vaddlv_u8(__rev0);
42059 return __ret;
42060}
4083742061#endif
4083842062
4083942063#ifdef __LITTLE_ENDIAN__
40840#define vst2q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40841 bfloat16x8x2_t __s1 = __p1; \
40842 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 43); \
40843})
42064__ai uint64_t vaddlv_u32(uint32x2_t __p0) {
42065 uint64_t __ret;
42066 __ret = (uint64_t) __builtin_neon_vaddlv_u32(__p0);
42067 return __ret;
42068}
4084442069#else
40845#define vst2q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40846 bfloat16x8x2_t __s1 = __p1; \
40847 bfloat16x8x2_t __rev1; \
40848 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40849 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40850 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 43); \
40851})
42070__ai uint64_t vaddlv_u32(uint32x2_t __p0) {
42071 uint64_t __ret;
42072 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
42073 __ret = (uint64_t) __builtin_neon_vaddlv_u32(__rev0);
42074 return __ret;
42075}
4085242076#endif
4085342077
4085442078#ifdef __LITTLE_ENDIAN__
40855#define vst2_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40856 bfloat16x4x2_t __s1 = __p1; \
40857 __builtin_neon_vst2_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], __p2, 11); \
40858})
42079__ai uint32_t vaddlv_u16(uint16x4_t __p0) {
42080 uint32_t __ret;
42081 __ret = (uint32_t) __builtin_neon_vaddlv_u16(__p0);
42082 return __ret;
42083}
4085942084#else
40860#define vst2_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40861 bfloat16x4x2_t __s1 = __p1; \
40862 bfloat16x4x2_t __rev1; \
40863 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
40864 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
40865 __builtin_neon_vst2_lane_v(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], __p2, 11); \
40866})
42085__ai uint32_t vaddlv_u16(uint16x4_t __p0) {
42086 uint32_t __ret;
42087 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
42088 __ret = (uint32_t) __builtin_neon_vaddlv_u16(__rev0);
42089 return __ret;
42090}
4086742091#endif
4086842092
4086942093#ifdef __LITTLE_ENDIAN__
40870#define vst3q_bf16(__p0, __p1) __extension__ ({ \
40871 bfloat16x8x3_t __s1 = __p1; \
40872 __builtin_neon_vst3q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], 43); \
40873})
42094__ai int16_t vaddlv_s8(int8x8_t __p0) {
42095 int16_t __ret;
42096 __ret = (int16_t) __builtin_neon_vaddlv_s8(__p0);
42097 return __ret;
42098}
4087442099#else
40875#define vst3q_bf16(__p0, __p1) __extension__ ({ \
40876 bfloat16x8x3_t __s1 = __p1; \
40877 bfloat16x8x3_t __rev1; \
40878 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40879 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40880 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
40881 __builtin_neon_vst3q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], 43); \
40882})
42100__ai int16_t vaddlv_s8(int8x8_t __p0) {
42101 int16_t __ret;
42102 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
42103 __ret = (int16_t) __builtin_neon_vaddlv_s8(__rev0);
42104 return __ret;
42105}
4088342106#endif
4088442107
4088542108#ifdef __LITTLE_ENDIAN__
40886#define vst3_bf16(__p0, __p1) __extension__ ({ \
40887 bfloat16x4x3_t __s1 = __p1; \
40888 __builtin_neon_vst3_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], 11); \
40889})
42109__ai int64_t vaddlv_s32(int32x2_t __p0) {
42110 int64_t __ret;
42111 __ret = (int64_t) __builtin_neon_vaddlv_s32(__p0);
42112 return __ret;
42113}
4089042114#else
40891#define vst3_bf16(__p0, __p1) __extension__ ({ \
40892 bfloat16x4x3_t __s1 = __p1; \
40893 bfloat16x4x3_t __rev1; \
40894 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
40895 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
40896 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
40897 __builtin_neon_vst3_v(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], 11); \
40898})
42115__ai int64_t vaddlv_s32(int32x2_t __p0) {
42116 int64_t __ret;
42117 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
42118 __ret = (int64_t) __builtin_neon_vaddlv_s32(__rev0);
42119 return __ret;
42120}
4089942121#endif
4090042122
4090142123#ifdef __LITTLE_ENDIAN__
40902#define vst3q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40903 bfloat16x8x3_t __s1 = __p1; \
40904 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 43); \
40905})
42124__ai int32_t vaddlv_s16(int16x4_t __p0) {
42125 int32_t __ret;
42126 __ret = (int32_t) __builtin_neon_vaddlv_s16(__p0);
42127 return __ret;
42128}
4090642129#else
40907#define vst3q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40908 bfloat16x8x3_t __s1 = __p1; \
40909 bfloat16x8x3_t __rev1; \
40910 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40911 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40912 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
40913 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 43); \
40914})
42130__ai int32_t vaddlv_s16(int16x4_t __p0) {
42131 int32_t __ret;
42132 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
42133 __ret = (int32_t) __builtin_neon_vaddlv_s16(__rev0);
42134 return __ret;
42135}
4091542136#endif
4091642137
4091742138#ifdef __LITTLE_ENDIAN__
40918#define vst3_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40919 bfloat16x4x3_t __s1 = __p1; \
40920 __builtin_neon_vst3_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], __p2, 11); \
40921})
42139__ai uint8_t vaddvq_u8(uint8x16_t __p0) {
42140 uint8_t __ret;
42141 __ret = (uint8_t) __builtin_neon_vaddvq_u8(__p0);
42142 return __ret;
42143}
4092242144#else
40923#define vst3_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40924 bfloat16x4x3_t __s1 = __p1; \
40925 bfloat16x4x3_t __rev1; \
40926 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
40927 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
40928 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
40929 __builtin_neon_vst3_lane_v(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], __p2, 11); \
40930})
42145__ai uint8_t vaddvq_u8(uint8x16_t __p0) {
42146 uint8_t __ret;
42147 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
42148 __ret = (uint8_t) __builtin_neon_vaddvq_u8(__rev0);
42149 return __ret;
42150}
4093142151#endif
4093242152
4093342153#ifdef __LITTLE_ENDIAN__
40934#define vst4q_bf16(__p0, __p1) __extension__ ({ \
40935 bfloat16x8x4_t __s1 = __p1; \
40936 __builtin_neon_vst4q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], 43); \
40937})
42154__ai uint32_t vaddvq_u32(uint32x4_t __p0) {
42155 uint32_t __ret;
42156 __ret = (uint32_t) __builtin_neon_vaddvq_u32(__p0);
42157 return __ret;
42158}
4093842159#else
40939#define vst4q_bf16(__p0, __p1) __extension__ ({ \
40940 bfloat16x8x4_t __s1 = __p1; \
40941 bfloat16x8x4_t __rev1; \
40942 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40943 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40944 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
40945 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
40946 __builtin_neon_vst4q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], 43); \
40947})
42160__ai uint32_t vaddvq_u32(uint32x4_t __p0) {
42161 uint32_t __ret;
42162 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
42163 __ret = (uint32_t) __builtin_neon_vaddvq_u32(__rev0);
42164 return __ret;
42165}
4094842166#endif
4094942167
4095042168#ifdef __LITTLE_ENDIAN__
40951#define vst4_bf16(__p0, __p1) __extension__ ({ \
40952 bfloat16x4x4_t __s1 = __p1; \
40953 __builtin_neon_vst4_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], 11); \
40954})
40955#else
40956#define vst4_bf16(__p0, __p1) __extension__ ({ \
40957 bfloat16x4x4_t __s1 = __p1; \
40958 bfloat16x4x4_t __rev1; \
40959 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
40960 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
40961 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
40962 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 3, 2, 1, 0); \
40963 __builtin_neon_vst4_v(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], (int8x8_t)__rev1.val[3], 11); \
40964})
42169__ai uint64_t vaddvq_u64(uint64x2_t __p0) {
42170 uint64_t __ret;
42171 __ret = (uint64_t) __builtin_neon_vaddvq_u64(__p0);
42172 return __ret;
42173}
42174#else
42175__ai uint64_t vaddvq_u64(uint64x2_t __p0) {
42176 uint64_t __ret;
42177 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
42178 __ret = (uint64_t) __builtin_neon_vaddvq_u64(__rev0);
42179 return __ret;
42180}
4096542181#endif
4096642182
4096742183#ifdef __LITTLE_ENDIAN__
40968#define vst4q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40969 bfloat16x8x4_t __s1 = __p1; \
40970 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 43); \
40971})
42184__ai uint16_t vaddvq_u16(uint16x8_t __p0) {
42185 uint16_t __ret;
42186 __ret = (uint16_t) __builtin_neon_vaddvq_u16(__p0);
42187 return __ret;
42188}
4097242189#else
40973#define vst4q_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40974 bfloat16x8x4_t __s1 = __p1; \
40975 bfloat16x8x4_t __rev1; \
40976 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 7, 6, 5, 4, 3, 2, 1, 0); \
40977 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 7, 6, 5, 4, 3, 2, 1, 0); \
40978 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 7, 6, 5, 4, 3, 2, 1, 0); \
40979 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 7, 6, 5, 4, 3, 2, 1, 0); \
40980 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 43); \
40981})
42190__ai uint16_t vaddvq_u16(uint16x8_t __p0) {
42191 uint16_t __ret;
42192 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
42193 __ret = (uint16_t) __builtin_neon_vaddvq_u16(__rev0);
42194 return __ret;
42195}
4098242196#endif
4098342197
4098442198#ifdef __LITTLE_ENDIAN__
40985#define vst4_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40986 bfloat16x4x4_t __s1 = __p1; \
40987 __builtin_neon_vst4_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], __p2, 11); \
40988})
42199__ai int8_t vaddvq_s8(int8x16_t __p0) {
42200 int8_t __ret;
42201 __ret = (int8_t) __builtin_neon_vaddvq_s8(__p0);
42202 return __ret;
42203}
4098942204#else
40990#define vst4_lane_bf16(__p0, __p1, __p2) __extension__ ({ \
40991 bfloat16x4x4_t __s1 = __p1; \
40992 bfloat16x4x4_t __rev1; \
40993 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 3, 2, 1, 0); \
40994 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 3, 2, 1, 0); \
40995 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 3, 2, 1, 0); \
40996 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 3, 2, 1, 0); \
40997 __builtin_neon_vst4_lane_v(__p0, (int8x8_t)__rev1.val[0], (int8x8_t)__rev1.val[1], (int8x8_t)__rev1.val[2], (int8x8_t)__rev1.val[3], __p2, 11); \
40998})
42205__ai int8_t vaddvq_s8(int8x16_t __p0) {
42206 int8_t __ret;
42207 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
42208 __ret = (int8_t) __builtin_neon_vaddvq_s8(__rev0);
42209 return __ret;
42210}
4099942211#endif
4100042212
41001#endif
41002#if defined(__ARM_FEATURE_BF16_VECTOR_ARITHMETIC) && !defined(__aarch64__)
4100342213#ifdef __LITTLE_ENDIAN__
41004__ai bfloat16x4_t __a32_vcvt_bf16_f32(float32x4_t __p0) {
41005 bfloat16x4_t __ret;
41006 __ret = (bfloat16x4_t) __builtin_neon___a32_vcvt_bf16_v((int8x16_t)__p0, 11);
42214__ai float64_t vaddvq_f64(float64x2_t __p0) {
42215 float64_t __ret;
42216 __ret = (float64_t) __builtin_neon_vaddvq_f64(__p0);
4100742217 return __ret;
4100842218}
4100942219#else
41010__ai bfloat16x4_t __a32_vcvt_bf16_f32(float32x4_t __p0) {
41011 bfloat16x4_t __ret;
41012 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41013 __ret = (bfloat16x4_t) __builtin_neon___a32_vcvt_bf16_v((int8x16_t)__rev0, 11);
41014 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
41015 return __ret;
41016}
41017__ai bfloat16x4_t __noswap___a32_vcvt_bf16_f32(float32x4_t __p0) {
41018 bfloat16x4_t __ret;
41019 __ret = (bfloat16x4_t) __builtin_neon___a32_vcvt_bf16_v((int8x16_t)__p0, 11);
42220__ai float64_t vaddvq_f64(float64x2_t __p0) {
42221 float64_t __ret;
42222 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
42223 __ret = (float64_t) __builtin_neon_vaddvq_f64(__rev0);
4102042224 return __ret;
4102142225}
4102242226#endif
4102342227
4102442228#ifdef __LITTLE_ENDIAN__
41025__ai bfloat16x4_t vcvt_bf16_f32(float32x4_t __p0) {
41026 bfloat16x4_t __ret;
41027 __ret = __a32_vcvt_bf16_f32(__p0);
42229__ai float32_t vaddvq_f32(float32x4_t __p0) {
42230 float32_t __ret;
42231 __ret = (float32_t) __builtin_neon_vaddvq_f32(__p0);
4102842232 return __ret;
4102942233}
4103042234#else
41031__ai bfloat16x4_t vcvt_bf16_f32(float32x4_t __p0) {
41032 bfloat16x4_t __ret;
42235__ai float32_t vaddvq_f32(float32x4_t __p0) {
42236 float32_t __ret;
4103342237 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41034 __ret = __noswap___a32_vcvt_bf16_f32(__rev0);
41035 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
42238 __ret = (float32_t) __builtin_neon_vaddvq_f32(__rev0);
4103642239 return __ret;
4103742240}
4103842241#endif
4103942242
4104042243#ifdef __LITTLE_ENDIAN__
41041__ai bfloat16x8_t vcvtq_high_bf16_f32(bfloat16x8_t __p0, float32x4_t __p1) {
41042 bfloat16x8_t __ret;
41043 __ret = vcombine_bf16(__a32_vcvt_bf16_f32(__p1), vget_low_bf16(__p0));
42244__ai int32_t vaddvq_s32(int32x4_t __p0) {
42245 int32_t __ret;
42246 __ret = (int32_t) __builtin_neon_vaddvq_s32(__p0);
4104442247 return __ret;
4104542248}
4104642249#else
41047__ai bfloat16x8_t vcvtq_high_bf16_f32(bfloat16x8_t __p0, float32x4_t __p1) {
41048 bfloat16x8_t __ret;
41049 bfloat16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
41050 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
41051 __ret = __noswap_vcombine_bf16(__noswap___a32_vcvt_bf16_f32(__rev1), __noswap_vget_low_bf16(__rev0));
41052 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
42250__ai int32_t vaddvq_s32(int32x4_t __p0) {
42251 int32_t __ret;
42252 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
42253 __ret = (int32_t) __builtin_neon_vaddvq_s32(__rev0);
4105342254 return __ret;
4105442255}
4105542256#endif
4105642257
4105742258#ifdef __LITTLE_ENDIAN__
41058__ai bfloat16x8_t vcvtq_low_bf16_f32(float32x4_t __p0) {
41059 bfloat16x8_t __ret;
41060 __ret = vcombine_bf16((bfloat16x4_t)(0ULL), __a32_vcvt_bf16_f32(__p0));
42259__ai int64_t vaddvq_s64(int64x2_t __p0) {
42260 int64_t __ret;
42261 __ret = (int64_t) __builtin_neon_vaddvq_s64(__p0);
4106142262 return __ret;
4106242263}
4106342264#else
41064__ai bfloat16x8_t vcvtq_low_bf16_f32(float32x4_t __p0) {
41065 bfloat16x8_t __ret;
41066 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41067 __ret = __noswap_vcombine_bf16((bfloat16x4_t)(0ULL), __noswap___a32_vcvt_bf16_f32(__rev0));
41068 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
42265__ai int64_t vaddvq_s64(int64x2_t __p0) {
42266 int64_t __ret;
42267 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
42268 __ret = (int64_t) __builtin_neon_vaddvq_s64(__rev0);
4106942269 return __ret;
4107042270}
4107142271#endif
4107242272
41073#endif
41074#if defined(__ARM_FEATURE_BF16_VECTOR_ARITHMETIC) && defined(__aarch64__)
4107542273#ifdef __LITTLE_ENDIAN__
41076__ai bfloat16x8_t __a64_vcvtq_low_bf16_f32(float32x4_t __p0) {
41077 bfloat16x8_t __ret;
41078 __ret = (bfloat16x8_t) __builtin_neon___a64_vcvtq_low_bf16_v((int8x16_t)__p0, 43);
42274__ai int16_t vaddvq_s16(int16x8_t __p0) {
42275 int16_t __ret;
42276 __ret = (int16_t) __builtin_neon_vaddvq_s16(__p0);
4107942277 return __ret;
4108042278}
4108142279#else
41082__ai bfloat16x8_t __a64_vcvtq_low_bf16_f32(float32x4_t __p0) {
41083 bfloat16x8_t __ret;
41084 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41085 __ret = (bfloat16x8_t) __builtin_neon___a64_vcvtq_low_bf16_v((int8x16_t)__rev0, 43);
41086 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
41087 return __ret;
41088}
41089__ai bfloat16x8_t __noswap___a64_vcvtq_low_bf16_f32(float32x4_t __p0) {
41090 bfloat16x8_t __ret;
41091 __ret = (bfloat16x8_t) __builtin_neon___a64_vcvtq_low_bf16_v((int8x16_t)__p0, 43);
42280__ai int16_t vaddvq_s16(int16x8_t __p0) {
42281 int16_t __ret;
42282 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
42283 __ret = (int16_t) __builtin_neon_vaddvq_s16(__rev0);
4109242284 return __ret;
4109342285}
4109442286#endif
4109542287
4109642288#ifdef __LITTLE_ENDIAN__
41097#define vcopyq_lane_bf16(__p0_161, __p1_161, __p2_161, __p3_161) __extension__ ({ \
41098 bfloat16x8_t __ret_161; \
41099 bfloat16x8_t __s0_161 = __p0_161; \
41100 bfloat16x4_t __s2_161 = __p2_161; \
41101 __ret_161 = vsetq_lane_bf16(vget_lane_bf16(__s2_161, __p3_161), __s0_161, __p1_161); \
41102 __ret_161; \
41103})
42289__ai uint8_t vaddv_u8(uint8x8_t __p0) {
42290 uint8_t __ret;
42291 __ret = (uint8_t) __builtin_neon_vaddv_u8(__p0);
42292 return __ret;
42293}
4110442294#else
41105#define vcopyq_lane_bf16(__p0_162, __p1_162, __p2_162, __p3_162) __extension__ ({ \
41106 bfloat16x8_t __ret_162; \
41107 bfloat16x8_t __s0_162 = __p0_162; \
41108 bfloat16x4_t __s2_162 = __p2_162; \
41109 bfloat16x8_t __rev0_162; __rev0_162 = __builtin_shufflevector(__s0_162, __s0_162, 7, 6, 5, 4, 3, 2, 1, 0); \
41110 bfloat16x4_t __rev2_162; __rev2_162 = __builtin_shufflevector(__s2_162, __s2_162, 3, 2, 1, 0); \
41111 __ret_162 = __noswap_vsetq_lane_bf16(__noswap_vget_lane_bf16(__rev2_162, __p3_162), __rev0_162, __p1_162); \
41112 __ret_162 = __builtin_shufflevector(__ret_162, __ret_162, 7, 6, 5, 4, 3, 2, 1, 0); \
41113 __ret_162; \
41114})
42295__ai uint8_t vaddv_u8(uint8x8_t __p0) {
42296 uint8_t __ret;
42297 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
42298 __ret = (uint8_t) __builtin_neon_vaddv_u8(__rev0);
42299 return __ret;
42300}
4111542301#endif
4111642302
4111742303#ifdef __LITTLE_ENDIAN__
41118#define vcopy_lane_bf16(__p0_163, __p1_163, __p2_163, __p3_163) __extension__ ({ \
41119 bfloat16x4_t __ret_163; \
41120 bfloat16x4_t __s0_163 = __p0_163; \
41121 bfloat16x4_t __s2_163 = __p2_163; \
41122 __ret_163 = vset_lane_bf16(vget_lane_bf16(__s2_163, __p3_163), __s0_163, __p1_163); \
41123 __ret_163; \
41124})
42304__ai uint32_t vaddv_u32(uint32x2_t __p0) {
42305 uint32_t __ret;
42306 __ret = (uint32_t) __builtin_neon_vaddv_u32(__p0);
42307 return __ret;
42308}
4112542309#else
41126#define vcopy_lane_bf16(__p0_164, __p1_164, __p2_164, __p3_164) __extension__ ({ \
41127 bfloat16x4_t __ret_164; \
41128 bfloat16x4_t __s0_164 = __p0_164; \
41129 bfloat16x4_t __s2_164 = __p2_164; \
41130 bfloat16x4_t __rev0_164; __rev0_164 = __builtin_shufflevector(__s0_164, __s0_164, 3, 2, 1, 0); \
41131 bfloat16x4_t __rev2_164; __rev2_164 = __builtin_shufflevector(__s2_164, __s2_164, 3, 2, 1, 0); \
41132 __ret_164 = __noswap_vset_lane_bf16(__noswap_vget_lane_bf16(__rev2_164, __p3_164), __rev0_164, __p1_164); \
41133 __ret_164 = __builtin_shufflevector(__ret_164, __ret_164, 3, 2, 1, 0); \
41134 __ret_164; \
41135})
42310__ai uint32_t vaddv_u32(uint32x2_t __p0) {
42311 uint32_t __ret;
42312 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
42313 __ret = (uint32_t) __builtin_neon_vaddv_u32(__rev0);
42314 return __ret;
42315}
4113642316#endif
4113742317
4113842318#ifdef __LITTLE_ENDIAN__
41139#define vcopyq_laneq_bf16(__p0_165, __p1_165, __p2_165, __p3_165) __extension__ ({ \
41140 bfloat16x8_t __ret_165; \
41141 bfloat16x8_t __s0_165 = __p0_165; \
41142 bfloat16x8_t __s2_165 = __p2_165; \
41143 __ret_165 = vsetq_lane_bf16(vgetq_lane_bf16(__s2_165, __p3_165), __s0_165, __p1_165); \
41144 __ret_165; \
41145})
42319__ai uint16_t vaddv_u16(uint16x4_t __p0) {
42320 uint16_t __ret;
42321 __ret = (uint16_t) __builtin_neon_vaddv_u16(__p0);
42322 return __ret;
42323}
4114642324#else
41147#define vcopyq_laneq_bf16(__p0_166, __p1_166, __p2_166, __p3_166) __extension__ ({ \
41148 bfloat16x8_t __ret_166; \
41149 bfloat16x8_t __s0_166 = __p0_166; \
41150 bfloat16x8_t __s2_166 = __p2_166; \
41151 bfloat16x8_t __rev0_166; __rev0_166 = __builtin_shufflevector(__s0_166, __s0_166, 7, 6, 5, 4, 3, 2, 1, 0); \
41152 bfloat16x8_t __rev2_166; __rev2_166 = __builtin_shufflevector(__s2_166, __s2_166, 7, 6, 5, 4, 3, 2, 1, 0); \
41153 __ret_166 = __noswap_vsetq_lane_bf16(__noswap_vgetq_lane_bf16(__rev2_166, __p3_166), __rev0_166, __p1_166); \
41154 __ret_166 = __builtin_shufflevector(__ret_166, __ret_166, 7, 6, 5, 4, 3, 2, 1, 0); \
41155 __ret_166; \
41156})
42325__ai uint16_t vaddv_u16(uint16x4_t __p0) {
42326 uint16_t __ret;
42327 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
42328 __ret = (uint16_t) __builtin_neon_vaddv_u16(__rev0);
42329 return __ret;
42330}
4115742331#endif
4115842332
4115942333#ifdef __LITTLE_ENDIAN__
41160#define vcopy_laneq_bf16(__p0_167, __p1_167, __p2_167, __p3_167) __extension__ ({ \
41161 bfloat16x4_t __ret_167; \
41162 bfloat16x4_t __s0_167 = __p0_167; \
41163 bfloat16x8_t __s2_167 = __p2_167; \
41164 __ret_167 = vset_lane_bf16(vgetq_lane_bf16(__s2_167, __p3_167), __s0_167, __p1_167); \
41165 __ret_167; \
41166})
42334__ai int8_t vaddv_s8(int8x8_t __p0) {
42335 int8_t __ret;
42336 __ret = (int8_t) __builtin_neon_vaddv_s8(__p0);
42337 return __ret;
42338}
4116742339#else
41168#define vcopy_laneq_bf16(__p0_168, __p1_168, __p2_168, __p3_168) __extension__ ({ \
41169 bfloat16x4_t __ret_168; \
41170 bfloat16x4_t __s0_168 = __p0_168; \
41171 bfloat16x8_t __s2_168 = __p2_168; \
41172 bfloat16x4_t __rev0_168; __rev0_168 = __builtin_shufflevector(__s0_168, __s0_168, 3, 2, 1, 0); \
41173 bfloat16x8_t __rev2_168; __rev2_168 = __builtin_shufflevector(__s2_168, __s2_168, 7, 6, 5, 4, 3, 2, 1, 0); \
41174 __ret_168 = __noswap_vset_lane_bf16(__noswap_vgetq_lane_bf16(__rev2_168, __p3_168), __rev0_168, __p1_168); \
41175 __ret_168 = __builtin_shufflevector(__ret_168, __ret_168, 3, 2, 1, 0); \
41176 __ret_168; \
41177})
42340__ai int8_t vaddv_s8(int8x8_t __p0) {
42341 int8_t __ret;
42342 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
42343 __ret = (int8_t) __builtin_neon_vaddv_s8(__rev0);
42344 return __ret;
42345}
4117842346#endif
4117942347
4118042348#ifdef __LITTLE_ENDIAN__
41181__ai bfloat16x4_t vcvt_bf16_f32(float32x4_t __p0) {
41182 bfloat16x4_t __ret;
41183 __ret = vget_low_bf16(__a64_vcvtq_low_bf16_f32(__p0));
42349__ai float32_t vaddv_f32(float32x2_t __p0) {
42350 float32_t __ret;
42351 __ret = (float32_t) __builtin_neon_vaddv_f32(__p0);
4118442352 return __ret;
4118542353}
4118642354#else
41187__ai bfloat16x4_t vcvt_bf16_f32(float32x4_t __p0) {
41188 bfloat16x4_t __ret;
41189 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41190 __ret = __noswap_vget_low_bf16(__noswap___a64_vcvtq_low_bf16_f32(__rev0));
41191 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
42355__ai float32_t vaddv_f32(float32x2_t __p0) {
42356 float32_t __ret;
42357 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
42358 __ret = (float32_t) __builtin_neon_vaddv_f32(__rev0);
4119242359 return __ret;
4119342360}
4119442361#endif
4119542362
4119642363#ifdef __LITTLE_ENDIAN__
41197__ai bfloat16x8_t vcvtq_high_bf16_f32(bfloat16x8_t __p0, float32x4_t __p1) {
41198 bfloat16x8_t __ret;
41199 __ret = (bfloat16x8_t) __builtin_neon_vcvtq_high_bf16_v((int8x16_t)__p0, (int8x16_t)__p1, 43);
42364__ai int32_t vaddv_s32(int32x2_t __p0) {
42365 int32_t __ret;
42366 __ret = (int32_t) __builtin_neon_vaddv_s32(__p0);
4120042367 return __ret;
4120142368}
4120242369#else
41203__ai bfloat16x8_t vcvtq_high_bf16_f32(bfloat16x8_t __p0, float32x4_t __p1) {
41204 bfloat16x8_t __ret;
41205 bfloat16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
41206 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
41207 __ret = (bfloat16x8_t) __builtin_neon_vcvtq_high_bf16_v((int8x16_t)__rev0, (int8x16_t)__rev1, 43);
41208 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
42370__ai int32_t vaddv_s32(int32x2_t __p0) {
42371 int32_t __ret;
42372 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
42373 __ret = (int32_t) __builtin_neon_vaddv_s32(__rev0);
4120942374 return __ret;
4121042375}
4121142376#endif
4121242377
4121342378#ifdef __LITTLE_ENDIAN__
41214__ai bfloat16x8_t vcvtq_low_bf16_f32(float32x4_t __p0) {
41215 bfloat16x8_t __ret;
41216 __ret = __a64_vcvtq_low_bf16_f32(__p0);
42379__ai int16_t vaddv_s16(int16x4_t __p0) {
42380 int16_t __ret;
42381 __ret = (int16_t) __builtin_neon_vaddv_s16(__p0);
4121742382 return __ret;
4121842383}
4121942384#else
41220__ai bfloat16x8_t vcvtq_low_bf16_f32(float32x4_t __p0) {
41221 bfloat16x8_t __ret;
41222 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41223 __ret = __noswap___a64_vcvtq_low_bf16_f32(__rev0);
41224 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
42385__ai int16_t vaddv_s16(int16x4_t __p0) {
42386 int16_t __ret;
42387 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
42388 __ret = (int16_t) __builtin_neon_vaddv_s16(__rev0);
4122542389 return __ret;
4122642390}
4122742391#endif
4122842392
41229#endif
41230#if defined(__ARM_FEATURE_COMPLEX)
42393__ai poly64x1_t vbsl_p64(uint64x1_t __p0, poly64x1_t __p1, poly64x1_t __p2) {
42394 poly64x1_t __ret;
42395 __ret = (poly64x1_t) __builtin_neon_vbsl_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 6);
42396 return __ret;
42397}
4123142398#ifdef __LITTLE_ENDIAN__
41232__ai float32x2_t vcadd_rot270_f32(float32x2_t __p0, float32x2_t __p1) {
41233 float32x2_t __ret;
41234 __ret = (float32x2_t) __builtin_neon_vcadd_rot270_v((int8x8_t)__p0, (int8x8_t)__p1, 9);
42399__ai poly64x2_t vbslq_p64(uint64x2_t __p0, poly64x2_t __p1, poly64x2_t __p2) {
42400 poly64x2_t __ret;
42401 __ret = (poly64x2_t) __builtin_neon_vbslq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 38);
4123542402 return __ret;
4123642403}
4123742404#else
41238__ai float32x2_t vcadd_rot270_f32(float32x2_t __p0, float32x2_t __p1) {
41239 float32x2_t __ret;
41240 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
41241 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
41242 __ret = (float32x2_t) __builtin_neon_vcadd_rot270_v((int8x8_t)__rev0, (int8x8_t)__rev1, 9);
42405__ai poly64x2_t vbslq_p64(uint64x2_t __p0, poly64x2_t __p1, poly64x2_t __p2) {
42406 poly64x2_t __ret;
42407 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
42408 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
42409 poly64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
42410 __ret = (poly64x2_t) __builtin_neon_vbslq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 38);
4124342411 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4124442412 return __ret;
4124542413}
4124642414#endif
4124742415
4124842416#ifdef __LITTLE_ENDIAN__
41249__ai float32x2_t vcadd_rot90_f32(float32x2_t __p0, float32x2_t __p1) {
41250 float32x2_t __ret;
41251 __ret = (float32x2_t) __builtin_neon_vcadd_rot90_v((int8x8_t)__p0, (int8x8_t)__p1, 9);
42417__ai float64x2_t vbslq_f64(uint64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
42418 float64x2_t __ret;
42419 __ret = (float64x2_t) __builtin_neon_vbslq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 42);
4125242420 return __ret;
4125342421}
4125442422#else
41255__ai float32x2_t vcadd_rot90_f32(float32x2_t __p0, float32x2_t __p1) {
41256 float32x2_t __ret;
41257 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
41258 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
41259 __ret = (float32x2_t) __builtin_neon_vcadd_rot90_v((int8x8_t)__rev0, (int8x8_t)__rev1, 9);
42423__ai float64x2_t vbslq_f64(uint64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
42424 float64x2_t __ret;
42425 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
42426 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
42427 float64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
42428 __ret = (float64x2_t) __builtin_neon_vbslq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 42);
4126042429 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4126142430 return __ret;
4126242431}
4126342432#endif
4126442433
42434__ai float64x1_t vbsl_f64(uint64x1_t __p0, float64x1_t __p1, float64x1_t __p2) {
42435 float64x1_t __ret;
42436 __ret = (float64x1_t) __builtin_neon_vbsl_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 10);
42437 return __ret;
42438}
4126542439#ifdef __LITTLE_ENDIAN__
41266__ai float32x4_t vcaddq_rot270_f32(float32x4_t __p0, float32x4_t __p1) {
41267 float32x4_t __ret;
41268 __ret = (float32x4_t) __builtin_neon_vcaddq_rot270_v((int8x16_t)__p0, (int8x16_t)__p1, 41);
42440__ai uint64x2_t vcageq_f64(float64x2_t __p0, float64x2_t __p1) {
42441 uint64x2_t __ret;
42442 __ret = (uint64x2_t) __builtin_neon_vcageq_v((int8x16_t)__p0, (int8x16_t)__p1, 51);
4126942443 return __ret;
4127042444}
4127142445#else
41272__ai float32x4_t vcaddq_rot270_f32(float32x4_t __p0, float32x4_t __p1) {
41273 float32x4_t __ret;
41274 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41275 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
41276 __ret = (float32x4_t) __builtin_neon_vcaddq_rot270_v((int8x16_t)__rev0, (int8x16_t)__rev1, 41);
41277 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
42446__ai uint64x2_t vcageq_f64(float64x2_t __p0, float64x2_t __p1) {
42447 uint64x2_t __ret;
42448 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
42449 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
42450 __ret = (uint64x2_t) __builtin_neon_vcageq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 51);
42451 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4127842452 return __ret;
4127942453}
4128042454#endif
4128142455
42456__ai uint64x1_t vcage_f64(float64x1_t __p0, float64x1_t __p1) {
42457 uint64x1_t __ret;
42458 __ret = (uint64x1_t) __builtin_neon_vcage_v((int8x8_t)__p0, (int8x8_t)__p1, 19);
42459 return __ret;
42460}
42461__ai uint64_t vcaged_f64(float64_t __p0, float64_t __p1) {
42462 uint64_t __ret;
42463 __ret = (uint64_t) __builtin_neon_vcaged_f64(__p0, __p1);
42464 return __ret;
42465}
42466__ai uint32_t vcages_f32(float32_t __p0, float32_t __p1) {
42467 uint32_t __ret;
42468 __ret = (uint32_t) __builtin_neon_vcages_f32(__p0, __p1);
42469 return __ret;
42470}
4128242471#ifdef __LITTLE_ENDIAN__
41283__ai float32x4_t vcaddq_rot90_f32(float32x4_t __p0, float32x4_t __p1) {
41284 float32x4_t __ret;
41285 __ret = (float32x4_t) __builtin_neon_vcaddq_rot90_v((int8x16_t)__p0, (int8x16_t)__p1, 41);
42472__ai uint64x2_t vcagtq_f64(float64x2_t __p0, float64x2_t __p1) {
42473 uint64x2_t __ret;
42474 __ret = (uint64x2_t) __builtin_neon_vcagtq_v((int8x16_t)__p0, (int8x16_t)__p1, 51);
4128642475 return __ret;
4128742476}
4128842477#else
41289__ai float32x4_t vcaddq_rot90_f32(float32x4_t __p0, float32x4_t __p1) {
41290 float32x4_t __ret;
41291 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41292 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
41293 __ret = (float32x4_t) __builtin_neon_vcaddq_rot90_v((int8x16_t)__rev0, (int8x16_t)__rev1, 41);
41294 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
42478__ai uint64x2_t vcagtq_f64(float64x2_t __p0, float64x2_t __p1) {
42479 uint64x2_t __ret;
42480 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
42481 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
42482 __ret = (uint64x2_t) __builtin_neon_vcagtq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 51);
42483 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4129542484 return __ret;
4129642485}
4129742486#endif
4129842487
41299#ifdef __LITTLE_ENDIAN__
41300__ai float32x4_t vcmlaq_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
41301 float32x4_t __ret;
41302 __ret = (float32x4_t) __builtin_neon_vcmlaq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
42488__ai uint64x1_t vcagt_f64(float64x1_t __p0, float64x1_t __p1) {
42489 uint64x1_t __ret;
42490 __ret = (uint64x1_t) __builtin_neon_vcagt_v((int8x8_t)__p0, (int8x8_t)__p1, 19);
4130342491 return __ret;
4130442492}
41305#else
41306__ai float32x4_t vcmlaq_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
41307 float32x4_t __ret;
41308 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41309 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
41310 float32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
41311 __ret = (float32x4_t) __builtin_neon_vcmlaq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 41);
41312 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
42493__ai uint64_t vcagtd_f64(float64_t __p0, float64_t __p1) {
42494 uint64_t __ret;
42495 __ret = (uint64_t) __builtin_neon_vcagtd_f64(__p0, __p1);
4131342496 return __ret;
4131442497}
41315__ai float32x4_t __noswap_vcmlaq_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
41316 float32x4_t __ret;
41317 __ret = (float32x4_t) __builtin_neon_vcmlaq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
42498__ai uint32_t vcagts_f32(float32_t __p0, float32_t __p1) {
42499 uint32_t __ret;
42500 __ret = (uint32_t) __builtin_neon_vcagts_f32(__p0, __p1);
4131842501 return __ret;
4131942502}
41320#endif
41321
4132242503#ifdef __LITTLE_ENDIAN__
41323__ai float32x2_t vcmla_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
41324 float32x2_t __ret;
41325 __ret = (float32x2_t) __builtin_neon_vcmla_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
42504__ai uint64x2_t vcaleq_f64(float64x2_t __p0, float64x2_t __p1) {
42505 uint64x2_t __ret;
42506 __ret = (uint64x2_t) __builtin_neon_vcaleq_v((int8x16_t)__p0, (int8x16_t)__p1, 51);
4132642507 return __ret;
4132742508}
4132842509#else
41329__ai float32x2_t vcmla_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
41330 float32x2_t __ret;
41331 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
41332 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
41333 float32x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
41334 __ret = (float32x2_t) __builtin_neon_vcmla_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 9);
42510__ai uint64x2_t vcaleq_f64(float64x2_t __p0, float64x2_t __p1) {
42511 uint64x2_t __ret;
42512 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
42513 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
42514 __ret = (uint64x2_t) __builtin_neon_vcaleq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 51);
4133542515 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4133642516 return __ret;
4133742517}
41338__ai float32x2_t __noswap_vcmla_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
41339 float32x2_t __ret;
41340 __ret = (float32x2_t) __builtin_neon_vcmla_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
42518#endif
42519
42520__ai uint64x1_t vcale_f64(float64x1_t __p0, float64x1_t __p1) {
42521 uint64x1_t __ret;
42522 __ret = (uint64x1_t) __builtin_neon_vcale_v((int8x8_t)__p0, (int8x8_t)__p1, 19);
42523 return __ret;
42524}
42525__ai uint64_t vcaled_f64(float64_t __p0, float64_t __p1) {
42526 uint64_t __ret;
42527 __ret = (uint64_t) __builtin_neon_vcaled_f64(__p0, __p1);
42528 return __ret;
42529}
42530__ai uint32_t vcales_f32(float32_t __p0, float32_t __p1) {
42531 uint32_t __ret;
42532 __ret = (uint32_t) __builtin_neon_vcales_f32(__p0, __p1);
42533 return __ret;
42534}
42535#ifdef __LITTLE_ENDIAN__
42536__ai uint64x2_t vcaltq_f64(float64x2_t __p0, float64x2_t __p1) {
42537 uint64x2_t __ret;
42538 __ret = (uint64x2_t) __builtin_neon_vcaltq_v((int8x16_t)__p0, (int8x16_t)__p1, 51);
42539 return __ret;
42540}
42541#else
42542__ai uint64x2_t vcaltq_f64(float64x2_t __p0, float64x2_t __p1) {
42543 uint64x2_t __ret;
42544 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
42545 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
42546 __ret = (uint64x2_t) __builtin_neon_vcaltq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 51);
42547 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4134142548 return __ret;
4134242549}
4134342550#endif
4134442551
42552__ai uint64x1_t vcalt_f64(float64x1_t __p0, float64x1_t __p1) {
42553 uint64x1_t __ret;
42554 __ret = (uint64x1_t) __builtin_neon_vcalt_v((int8x8_t)__p0, (int8x8_t)__p1, 19);
42555 return __ret;
42556}
42557__ai uint64_t vcaltd_f64(float64_t __p0, float64_t __p1) {
42558 uint64_t __ret;
42559 __ret = (uint64_t) __builtin_neon_vcaltd_f64(__p0, __p1);
42560 return __ret;
42561}
42562__ai uint32_t vcalts_f32(float32_t __p0, float32_t __p1) {
42563 uint32_t __ret;
42564 __ret = (uint32_t) __builtin_neon_vcalts_f32(__p0, __p1);
42565 return __ret;
42566}
42567__ai uint64x1_t vceq_p64(poly64x1_t __p0, poly64x1_t __p1) {
42568 uint64x1_t __ret;
42569 __ret = (uint64x1_t)(__p0 == __p1);
42570 return __ret;
42571}
4134542572#ifdef __LITTLE_ENDIAN__
41346#define vcmla_lane_f32(__p0_169, __p1_169, __p2_169, __p3_169) __extension__ ({ \
41347 float32x2_t __ret_169; \
41348 float32x2_t __s0_169 = __p0_169; \
41349 float32x2_t __s1_169 = __p1_169; \
41350 float32x2_t __s2_169 = __p2_169; \
41351float32x2_t __reint_169 = __s2_169; \
41352uint64x1_t __reint1_169 = (uint64x1_t) {vget_lane_u64(*(uint64x1_t *) &__reint_169, __p3_169)}; \
41353 __ret_169 = vcmla_f32(__s0_169, __s1_169, *(float32x2_t *) &__reint1_169); \
41354 __ret_169; \
41355})
42573__ai uint64x2_t vceqq_p64(poly64x2_t __p0, poly64x2_t __p1) {
42574 uint64x2_t __ret;
42575 __ret = (uint64x2_t)(__p0 == __p1);
42576 return __ret;
42577}
4135642578#else
41357#define vcmla_lane_f32(__p0_170, __p1_170, __p2_170, __p3_170) __extension__ ({ \
41358 float32x2_t __ret_170; \
41359 float32x2_t __s0_170 = __p0_170; \
41360 float32x2_t __s1_170 = __p1_170; \
41361 float32x2_t __s2_170 = __p2_170; \
41362 float32x2_t __rev0_170; __rev0_170 = __builtin_shufflevector(__s0_170, __s0_170, 1, 0); \
41363 float32x2_t __rev1_170; __rev1_170 = __builtin_shufflevector(__s1_170, __s1_170, 1, 0); \
41364 float32x2_t __rev2_170; __rev2_170 = __builtin_shufflevector(__s2_170, __s2_170, 1, 0); \
41365float32x2_t __reint_170 = __rev2_170; \
41366uint64x1_t __reint1_170 = (uint64x1_t) {vget_lane_u64(*(uint64x1_t *) &__reint_170, __p3_170)}; \
41367 __ret_170 = __noswap_vcmla_f32(__rev0_170, __rev1_170, *(float32x2_t *) &__reint1_170); \
41368 __ret_170 = __builtin_shufflevector(__ret_170, __ret_170, 1, 0); \
41369 __ret_170; \
41370})
42579__ai uint64x2_t vceqq_p64(poly64x2_t __p0, poly64x2_t __p1) {
42580 uint64x2_t __ret;
42581 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
42582 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
42583 __ret = (uint64x2_t)(__rev0 == __rev1);
42584 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
42585 return __ret;
42586}
4137142587#endif
4137242588
4137342589#ifdef __LITTLE_ENDIAN__
41374#define vcmlaq_lane_f32(__p0_171, __p1_171, __p2_171, __p3_171) __extension__ ({ \
41375 float32x4_t __ret_171; \
41376 float32x4_t __s0_171 = __p0_171; \
41377 float32x4_t __s1_171 = __p1_171; \
41378 float32x2_t __s2_171 = __p2_171; \
41379float32x2_t __reint_171 = __s2_171; \
41380uint64x2_t __reint1_171 = (uint64x2_t) {vget_lane_u64(*(uint64x1_t *) &__reint_171, __p3_171), vget_lane_u64(*(uint64x1_t *) &__reint_171, __p3_171)}; \
41381 __ret_171 = vcmlaq_f32(__s0_171, __s1_171, *(float32x4_t *) &__reint1_171); \
41382 __ret_171; \
41383})
42590__ai uint64x2_t vceqq_u64(uint64x2_t __p0, uint64x2_t __p1) {
42591 uint64x2_t __ret;
42592 __ret = (uint64x2_t)(__p0 == __p1);
42593 return __ret;
42594}
4138442595#else
41385#define vcmlaq_lane_f32(__p0_172, __p1_172, __p2_172, __p3_172) __extension__ ({ \
41386 float32x4_t __ret_172; \
41387 float32x4_t __s0_172 = __p0_172; \
41388 float32x4_t __s1_172 = __p1_172; \
41389 float32x2_t __s2_172 = __p2_172; \
41390 float32x4_t __rev0_172; __rev0_172 = __builtin_shufflevector(__s0_172, __s0_172, 3, 2, 1, 0); \
41391 float32x4_t __rev1_172; __rev1_172 = __builtin_shufflevector(__s1_172, __s1_172, 3, 2, 1, 0); \
41392 float32x2_t __rev2_172; __rev2_172 = __builtin_shufflevector(__s2_172, __s2_172, 1, 0); \
41393float32x2_t __reint_172 = __rev2_172; \
41394uint64x2_t __reint1_172 = (uint64x2_t) {vget_lane_u64(*(uint64x1_t *) &__reint_172, __p3_172), vget_lane_u64(*(uint64x1_t *) &__reint_172, __p3_172)}; \
41395 __ret_172 = __noswap_vcmlaq_f32(__rev0_172, __rev1_172, *(float32x4_t *) &__reint1_172); \
41396 __ret_172 = __builtin_shufflevector(__ret_172, __ret_172, 3, 2, 1, 0); \
41397 __ret_172; \
41398})
42596__ai uint64x2_t vceqq_u64(uint64x2_t __p0, uint64x2_t __p1) {
42597 uint64x2_t __ret;
42598 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
42599 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
42600 __ret = (uint64x2_t)(__rev0 == __rev1);
42601 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
42602 return __ret;
42603}
4139942604#endif
4140042605
4140142606#ifdef __LITTLE_ENDIAN__
41402#define vcmla_laneq_f32(__p0_173, __p1_173, __p2_173, __p3_173) __extension__ ({ \
41403 float32x2_t __ret_173; \
41404 float32x2_t __s0_173 = __p0_173; \
41405 float32x2_t __s1_173 = __p1_173; \
41406 float32x4_t __s2_173 = __p2_173; \
41407float32x4_t __reint_173 = __s2_173; \
41408uint64x1_t __reint1_173 = (uint64x1_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_173, __p3_173)}; \
41409 __ret_173 = vcmla_f32(__s0_173, __s1_173, *(float32x2_t *) &__reint1_173); \
41410 __ret_173; \
41411})
42607__ai uint64x2_t vceqq_f64(float64x2_t __p0, float64x2_t __p1) {
42608 uint64x2_t __ret;
42609 __ret = (uint64x2_t)(__p0 == __p1);
42610 return __ret;
42611}
4141242612#else
41413#define vcmla_laneq_f32(__p0_174, __p1_174, __p2_174, __p3_174) __extension__ ({ \
41414 float32x2_t __ret_174; \
41415 float32x2_t __s0_174 = __p0_174; \
41416 float32x2_t __s1_174 = __p1_174; \
41417 float32x4_t __s2_174 = __p2_174; \
41418 float32x2_t __rev0_174; __rev0_174 = __builtin_shufflevector(__s0_174, __s0_174, 1, 0); \
41419 float32x2_t __rev1_174; __rev1_174 = __builtin_shufflevector(__s1_174, __s1_174, 1, 0); \
41420 float32x4_t __rev2_174; __rev2_174 = __builtin_shufflevector(__s2_174, __s2_174, 3, 2, 1, 0); \
41421float32x4_t __reint_174 = __rev2_174; \
41422uint64x1_t __reint1_174 = (uint64x1_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_174, __p3_174)}; \
41423 __ret_174 = __noswap_vcmla_f32(__rev0_174, __rev1_174, *(float32x2_t *) &__reint1_174); \
41424 __ret_174 = __builtin_shufflevector(__ret_174, __ret_174, 1, 0); \
41425 __ret_174; \
41426})
42613__ai uint64x2_t vceqq_f64(float64x2_t __p0, float64x2_t __p1) {
42614 uint64x2_t __ret;
42615 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
42616 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
42617 __ret = (uint64x2_t)(__rev0 == __rev1);
42618 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
42619 return __ret;
42620}
4142742621#endif
4142842622
4142942623#ifdef __LITTLE_ENDIAN__
41430#define vcmlaq_laneq_f32(__p0_175, __p1_175, __p2_175, __p3_175) __extension__ ({ \
41431 float32x4_t __ret_175; \
41432 float32x4_t __s0_175 = __p0_175; \
41433 float32x4_t __s1_175 = __p1_175; \
41434 float32x4_t __s2_175 = __p2_175; \
41435float32x4_t __reint_175 = __s2_175; \
41436uint64x2_t __reint1_175 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_175, __p3_175), vgetq_lane_u64(*(uint64x2_t *) &__reint_175, __p3_175)}; \
41437 __ret_175 = vcmlaq_f32(__s0_175, __s1_175, *(float32x4_t *) &__reint1_175); \
41438 __ret_175; \
41439})
42624__ai uint64x2_t vceqq_s64(int64x2_t __p0, int64x2_t __p1) {
42625 uint64x2_t __ret;
42626 __ret = (uint64x2_t)(__p0 == __p1);
42627 return __ret;
42628}
4144042629#else
41441#define vcmlaq_laneq_f32(__p0_176, __p1_176, __p2_176, __p3_176) __extension__ ({ \
41442 float32x4_t __ret_176; \
41443 float32x4_t __s0_176 = __p0_176; \
41444 float32x4_t __s1_176 = __p1_176; \
41445 float32x4_t __s2_176 = __p2_176; \
41446 float32x4_t __rev0_176; __rev0_176 = __builtin_shufflevector(__s0_176, __s0_176, 3, 2, 1, 0); \
41447 float32x4_t __rev1_176; __rev1_176 = __builtin_shufflevector(__s1_176, __s1_176, 3, 2, 1, 0); \
41448 float32x4_t __rev2_176; __rev2_176 = __builtin_shufflevector(__s2_176, __s2_176, 3, 2, 1, 0); \
41449float32x4_t __reint_176 = __rev2_176; \
41450uint64x2_t __reint1_176 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_176, __p3_176), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_176, __p3_176)}; \
41451 __ret_176 = __noswap_vcmlaq_f32(__rev0_176, __rev1_176, *(float32x4_t *) &__reint1_176); \
41452 __ret_176 = __builtin_shufflevector(__ret_176, __ret_176, 3, 2, 1, 0); \
41453 __ret_176; \
41454})
42630__ai uint64x2_t vceqq_s64(int64x2_t __p0, int64x2_t __p1) {
42631 uint64x2_t __ret;
42632 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
42633 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
42634 __ret = (uint64x2_t)(__rev0 == __rev1);
42635 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
42636 return __ret;
42637}
4145542638#endif
4145642639
42640__ai uint64x1_t vceq_u64(uint64x1_t __p0, uint64x1_t __p1) {
42641 uint64x1_t __ret;
42642 __ret = (uint64x1_t)(__p0 == __p1);
42643 return __ret;
42644}
42645__ai uint64x1_t vceq_f64(float64x1_t __p0, float64x1_t __p1) {
42646 uint64x1_t __ret;
42647 __ret = (uint64x1_t)(__p0 == __p1);
42648 return __ret;
42649}
42650__ai uint64x1_t vceq_s64(int64x1_t __p0, int64x1_t __p1) {
42651 uint64x1_t __ret;
42652 __ret = (uint64x1_t)(__p0 == __p1);
42653 return __ret;
42654}
42655__ai uint64_t vceqd_u64(uint64_t __p0, uint64_t __p1) {
42656 uint64_t __ret;
42657 __ret = (uint64_t) __builtin_neon_vceqd_u64(__p0, __p1);
42658 return __ret;
42659}
42660__ai uint64_t vceqd_s64(int64_t __p0, int64_t __p1) {
42661 uint64_t __ret;
42662 __ret = (uint64_t) __builtin_neon_vceqd_s64(__p0, __p1);
42663 return __ret;
42664}
42665__ai uint64_t vceqd_f64(float64_t __p0, float64_t __p1) {
42666 uint64_t __ret;
42667 __ret = (uint64_t) __builtin_neon_vceqd_f64(__p0, __p1);
42668 return __ret;
42669}
42670__ai uint32_t vceqs_f32(float32_t __p0, float32_t __p1) {
42671 uint32_t __ret;
42672 __ret = (uint32_t) __builtin_neon_vceqs_f32(__p0, __p1);
42673 return __ret;
42674}
4145742675#ifdef __LITTLE_ENDIAN__
41458__ai float32x4_t vcmlaq_rot180_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
41459 float32x4_t __ret;
41460 __ret = (float32x4_t) __builtin_neon_vcmlaq_rot180_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
42676__ai uint8x8_t vceqz_p8(poly8x8_t __p0) {
42677 uint8x8_t __ret;
42678 __ret = (uint8x8_t) __builtin_neon_vceqz_v((int8x8_t)__p0, 16);
4146142679 return __ret;
4146242680}
4146342681#else
41464__ai float32x4_t vcmlaq_rot180_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
41465 float32x4_t __ret;
41466 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41467 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
41468 float32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
41469 __ret = (float32x4_t) __builtin_neon_vcmlaq_rot180_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 41);
41470 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
42682__ai uint8x8_t vceqz_p8(poly8x8_t __p0) {
42683 uint8x8_t __ret;
42684 poly8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
42685 __ret = (uint8x8_t) __builtin_neon_vceqz_v((int8x8_t)__rev0, 16);
42686 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
42687 return __ret;
42688}
42689#endif
42690
42691__ai uint64x1_t vceqz_p64(poly64x1_t __p0) {
42692 uint64x1_t __ret;
42693 __ret = (uint64x1_t) __builtin_neon_vceqz_v((int8x8_t)__p0, 19);
42694 return __ret;
42695}
42696#ifdef __LITTLE_ENDIAN__
42697__ai uint8x16_t vceqzq_p8(poly8x16_t __p0) {
42698 uint8x16_t __ret;
42699 __ret = (uint8x16_t) __builtin_neon_vceqzq_v((int8x16_t)__p0, 48);
4147142700 return __ret;
4147242701}
41473__ai float32x4_t __noswap_vcmlaq_rot180_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
41474 float32x4_t __ret;
41475 __ret = (float32x4_t) __builtin_neon_vcmlaq_rot180_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
42702#else
42703__ai uint8x16_t vceqzq_p8(poly8x16_t __p0) {
42704 uint8x16_t __ret;
42705 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
42706 __ret = (uint8x16_t) __builtin_neon_vceqzq_v((int8x16_t)__rev0, 48);
42707 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
4147642708 return __ret;
4147742709}
4147842710#endif
4147942711
4148042712#ifdef __LITTLE_ENDIAN__
41481__ai float32x2_t vcmla_rot180_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
41482 float32x2_t __ret;
41483 __ret = (float32x2_t) __builtin_neon_vcmla_rot180_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
42713__ai uint64x2_t vceqzq_p64(poly64x2_t __p0) {
42714 uint64x2_t __ret;
42715 __ret = (uint64x2_t) __builtin_neon_vceqzq_v((int8x16_t)__p0, 51);
4148442716 return __ret;
4148542717}
4148642718#else
41487__ai float32x2_t vcmla_rot180_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
41488 float32x2_t __ret;
41489 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
41490 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
41491 float32x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
41492 __ret = (float32x2_t) __builtin_neon_vcmla_rot180_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 9);
42719__ai uint64x2_t vceqzq_p64(poly64x2_t __p0) {
42720 uint64x2_t __ret;
42721 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
42722 __ret = (uint64x2_t) __builtin_neon_vceqzq_v((int8x16_t)__rev0, 51);
4149342723 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4149442724 return __ret;
4149542725}
41496__ai float32x2_t __noswap_vcmla_rot180_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
41497 float32x2_t __ret;
41498 __ret = (float32x2_t) __builtin_neon_vcmla_rot180_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
41499 return __ret;
41500}
4150142726#endif
4150242727
4150342728#ifdef __LITTLE_ENDIAN__
41504#define vcmla_rot180_lane_f32(__p0_177, __p1_177, __p2_177, __p3_177) __extension__ ({ \
41505 float32x2_t __ret_177; \
41506 float32x2_t __s0_177 = __p0_177; \
41507 float32x2_t __s1_177 = __p1_177; \
41508 float32x2_t __s2_177 = __p2_177; \
41509float32x2_t __reint_177 = __s2_177; \
41510uint64x1_t __reint1_177 = (uint64x1_t) {vget_lane_u64(*(uint64x1_t *) &__reint_177, __p3_177)}; \
41511 __ret_177 = vcmla_rot180_f32(__s0_177, __s1_177, *(float32x2_t *) &__reint1_177); \
41512 __ret_177; \
41513})
42729__ai uint8x16_t vceqzq_u8(uint8x16_t __p0) {
42730 uint8x16_t __ret;
42731 __ret = (uint8x16_t) __builtin_neon_vceqzq_v((int8x16_t)__p0, 48);
42732 return __ret;
42733}
4151442734#else
41515#define vcmla_rot180_lane_f32(__p0_178, __p1_178, __p2_178, __p3_178) __extension__ ({ \
41516 float32x2_t __ret_178; \
41517 float32x2_t __s0_178 = __p0_178; \
41518 float32x2_t __s1_178 = __p1_178; \
41519 float32x2_t __s2_178 = __p2_178; \
41520 float32x2_t __rev0_178; __rev0_178 = __builtin_shufflevector(__s0_178, __s0_178, 1, 0); \
41521 float32x2_t __rev1_178; __rev1_178 = __builtin_shufflevector(__s1_178, __s1_178, 1, 0); \
41522 float32x2_t __rev2_178; __rev2_178 = __builtin_shufflevector(__s2_178, __s2_178, 1, 0); \
41523float32x2_t __reint_178 = __rev2_178; \
41524uint64x1_t __reint1_178 = (uint64x1_t) {vget_lane_u64(*(uint64x1_t *) &__reint_178, __p3_178)}; \
41525 __ret_178 = __noswap_vcmla_rot180_f32(__rev0_178, __rev1_178, *(float32x2_t *) &__reint1_178); \
41526 __ret_178 = __builtin_shufflevector(__ret_178, __ret_178, 1, 0); \
41527 __ret_178; \
41528})
42735__ai uint8x16_t vceqzq_u8(uint8x16_t __p0) {
42736 uint8x16_t __ret;
42737 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
42738 __ret = (uint8x16_t) __builtin_neon_vceqzq_v((int8x16_t)__rev0, 48);
42739 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
42740 return __ret;
42741}
4152942742#endif
4153042743
4153142744#ifdef __LITTLE_ENDIAN__
41532#define vcmlaq_rot180_lane_f32(__p0_179, __p1_179, __p2_179, __p3_179) __extension__ ({ \
41533 float32x4_t __ret_179; \
41534 float32x4_t __s0_179 = __p0_179; \
41535 float32x4_t __s1_179 = __p1_179; \
41536 float32x2_t __s2_179 = __p2_179; \
41537float32x2_t __reint_179 = __s2_179; \
41538uint64x2_t __reint1_179 = (uint64x2_t) {vget_lane_u64(*(uint64x1_t *) &__reint_179, __p3_179), vget_lane_u64(*(uint64x1_t *) &__reint_179, __p3_179)}; \
41539 __ret_179 = vcmlaq_rot180_f32(__s0_179, __s1_179, *(float32x4_t *) &__reint1_179); \
41540 __ret_179; \
41541})
42745__ai uint32x4_t vceqzq_u32(uint32x4_t __p0) {
42746 uint32x4_t __ret;
42747 __ret = (uint32x4_t) __builtin_neon_vceqzq_v((int8x16_t)__p0, 50);
42748 return __ret;
42749}
4154242750#else
41543#define vcmlaq_rot180_lane_f32(__p0_180, __p1_180, __p2_180, __p3_180) __extension__ ({ \
41544 float32x4_t __ret_180; \
41545 float32x4_t __s0_180 = __p0_180; \
41546 float32x4_t __s1_180 = __p1_180; \
41547 float32x2_t __s2_180 = __p2_180; \
41548 float32x4_t __rev0_180; __rev0_180 = __builtin_shufflevector(__s0_180, __s0_180, 3, 2, 1, 0); \
41549 float32x4_t __rev1_180; __rev1_180 = __builtin_shufflevector(__s1_180, __s1_180, 3, 2, 1, 0); \
41550 float32x2_t __rev2_180; __rev2_180 = __builtin_shufflevector(__s2_180, __s2_180, 1, 0); \
41551float32x2_t __reint_180 = __rev2_180; \
41552uint64x2_t __reint1_180 = (uint64x2_t) {vget_lane_u64(*(uint64x1_t *) &__reint_180, __p3_180), vget_lane_u64(*(uint64x1_t *) &__reint_180, __p3_180)}; \
41553 __ret_180 = __noswap_vcmlaq_rot180_f32(__rev0_180, __rev1_180, *(float32x4_t *) &__reint1_180); \
41554 __ret_180 = __builtin_shufflevector(__ret_180, __ret_180, 3, 2, 1, 0); \
41555 __ret_180; \
41556})
42751__ai uint32x4_t vceqzq_u32(uint32x4_t __p0) {
42752 uint32x4_t __ret;
42753 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
42754 __ret = (uint32x4_t) __builtin_neon_vceqzq_v((int8x16_t)__rev0, 50);
42755 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
42756 return __ret;
42757}
4155742758#endif
4155842759
4155942760#ifdef __LITTLE_ENDIAN__
41560#define vcmla_rot180_laneq_f32(__p0_181, __p1_181, __p2_181, __p3_181) __extension__ ({ \
41561 float32x2_t __ret_181; \
41562 float32x2_t __s0_181 = __p0_181; \
41563 float32x2_t __s1_181 = __p1_181; \
41564 float32x4_t __s2_181 = __p2_181; \
41565float32x4_t __reint_181 = __s2_181; \
41566uint64x1_t __reint1_181 = (uint64x1_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_181, __p3_181)}; \
41567 __ret_181 = vcmla_rot180_f32(__s0_181, __s1_181, *(float32x2_t *) &__reint1_181); \
41568 __ret_181; \
41569})
42761__ai uint64x2_t vceqzq_u64(uint64x2_t __p0) {
42762 uint64x2_t __ret;
42763 __ret = (uint64x2_t) __builtin_neon_vceqzq_v((int8x16_t)__p0, 51);
42764 return __ret;
42765}
4157042766#else
41571#define vcmla_rot180_laneq_f32(__p0_182, __p1_182, __p2_182, __p3_182) __extension__ ({ \
41572 float32x2_t __ret_182; \
41573 float32x2_t __s0_182 = __p0_182; \
41574 float32x2_t __s1_182 = __p1_182; \
41575 float32x4_t __s2_182 = __p2_182; \
41576 float32x2_t __rev0_182; __rev0_182 = __builtin_shufflevector(__s0_182, __s0_182, 1, 0); \
41577 float32x2_t __rev1_182; __rev1_182 = __builtin_shufflevector(__s1_182, __s1_182, 1, 0); \
41578 float32x4_t __rev2_182; __rev2_182 = __builtin_shufflevector(__s2_182, __s2_182, 3, 2, 1, 0); \
41579float32x4_t __reint_182 = __rev2_182; \
41580uint64x1_t __reint1_182 = (uint64x1_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_182, __p3_182)}; \
41581 __ret_182 = __noswap_vcmla_rot180_f32(__rev0_182, __rev1_182, *(float32x2_t *) &__reint1_182); \
41582 __ret_182 = __builtin_shufflevector(__ret_182, __ret_182, 1, 0); \
41583 __ret_182; \
41584})
42767__ai uint64x2_t vceqzq_u64(uint64x2_t __p0) {
42768 uint64x2_t __ret;
42769 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
42770 __ret = (uint64x2_t) __builtin_neon_vceqzq_v((int8x16_t)__rev0, 51);
42771 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
42772 return __ret;
42773}
4158542774#endif
4158642775
4158742776#ifdef __LITTLE_ENDIAN__
41588#define vcmlaq_rot180_laneq_f32(__p0_183, __p1_183, __p2_183, __p3_183) __extension__ ({ \
41589 float32x4_t __ret_183; \
41590 float32x4_t __s0_183 = __p0_183; \
41591 float32x4_t __s1_183 = __p1_183; \
41592 float32x4_t __s2_183 = __p2_183; \
41593float32x4_t __reint_183 = __s2_183; \
41594uint64x2_t __reint1_183 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_183, __p3_183), vgetq_lane_u64(*(uint64x2_t *) &__reint_183, __p3_183)}; \
41595 __ret_183 = vcmlaq_rot180_f32(__s0_183, __s1_183, *(float32x4_t *) &__reint1_183); \
41596 __ret_183; \
41597})
42777__ai uint16x8_t vceqzq_u16(uint16x8_t __p0) {
42778 uint16x8_t __ret;
42779 __ret = (uint16x8_t) __builtin_neon_vceqzq_v((int8x16_t)__p0, 49);
42780 return __ret;
42781}
4159842782#else
41599#define vcmlaq_rot180_laneq_f32(__p0_184, __p1_184, __p2_184, __p3_184) __extension__ ({ \
41600 float32x4_t __ret_184; \
41601 float32x4_t __s0_184 = __p0_184; \
41602 float32x4_t __s1_184 = __p1_184; \
41603 float32x4_t __s2_184 = __p2_184; \
41604 float32x4_t __rev0_184; __rev0_184 = __builtin_shufflevector(__s0_184, __s0_184, 3, 2, 1, 0); \
41605 float32x4_t __rev1_184; __rev1_184 = __builtin_shufflevector(__s1_184, __s1_184, 3, 2, 1, 0); \
41606 float32x4_t __rev2_184; __rev2_184 = __builtin_shufflevector(__s2_184, __s2_184, 3, 2, 1, 0); \
41607float32x4_t __reint_184 = __rev2_184; \
41608uint64x2_t __reint1_184 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_184, __p3_184), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_184, __p3_184)}; \
41609 __ret_184 = __noswap_vcmlaq_rot180_f32(__rev0_184, __rev1_184, *(float32x4_t *) &__reint1_184); \
41610 __ret_184 = __builtin_shufflevector(__ret_184, __ret_184, 3, 2, 1, 0); \
41611 __ret_184; \
41612})
42783__ai uint16x8_t vceqzq_u16(uint16x8_t __p0) {
42784 uint16x8_t __ret;
42785 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
42786 __ret = (uint16x8_t) __builtin_neon_vceqzq_v((int8x16_t)__rev0, 49);
42787 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
42788 return __ret;
42789}
4161342790#endif
4161442791
4161542792#ifdef __LITTLE_ENDIAN__
41616__ai float32x4_t vcmlaq_rot270_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
41617 float32x4_t __ret;
41618 __ret = (float32x4_t) __builtin_neon_vcmlaq_rot270_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
42793__ai uint8x16_t vceqzq_s8(int8x16_t __p0) {
42794 uint8x16_t __ret;
42795 __ret = (uint8x16_t) __builtin_neon_vceqzq_v((int8x16_t)__p0, 48);
4161942796 return __ret;
4162042797}
4162142798#else
41622__ai float32x4_t vcmlaq_rot270_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
41623 float32x4_t __ret;
41624 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41625 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
41626 float32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
41627 __ret = (float32x4_t) __builtin_neon_vcmlaq_rot270_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 41);
41628 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
41629 return __ret;
41630}
41631__ai float32x4_t __noswap_vcmlaq_rot270_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
41632 float32x4_t __ret;
41633 __ret = (float32x4_t) __builtin_neon_vcmlaq_rot270_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
42799__ai uint8x16_t vceqzq_s8(int8x16_t __p0) {
42800 uint8x16_t __ret;
42801 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
42802 __ret = (uint8x16_t) __builtin_neon_vceqzq_v((int8x16_t)__rev0, 48);
42803 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
4163442804 return __ret;
4163542805}
4163642806#endif
4163742807
4163842808#ifdef __LITTLE_ENDIAN__
41639__ai float32x2_t vcmla_rot270_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
41640 float32x2_t __ret;
41641 __ret = (float32x2_t) __builtin_neon_vcmla_rot270_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
42809__ai uint64x2_t vceqzq_f64(float64x2_t __p0) {
42810 uint64x2_t __ret;
42811 __ret = (uint64x2_t) __builtin_neon_vceqzq_v((int8x16_t)__p0, 51);
4164242812 return __ret;
4164342813}
4164442814#else
41645__ai float32x2_t vcmla_rot270_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
41646 float32x2_t __ret;
41647 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
41648 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
41649 float32x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
41650 __ret = (float32x2_t) __builtin_neon_vcmla_rot270_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 9);
42815__ai uint64x2_t vceqzq_f64(float64x2_t __p0) {
42816 uint64x2_t __ret;
42817 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
42818 __ret = (uint64x2_t) __builtin_neon_vceqzq_v((int8x16_t)__rev0, 51);
4165142819 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4165242820 return __ret;
4165342821}
41654__ai float32x2_t __noswap_vcmla_rot270_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
41655 float32x2_t __ret;
41656 __ret = (float32x2_t) __builtin_neon_vcmla_rot270_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
41657 return __ret;
41658}
4165942822#endif
4166042823
4166142824#ifdef __LITTLE_ENDIAN__
41662#define vcmla_rot270_lane_f32(__p0_185, __p1_185, __p2_185, __p3_185) __extension__ ({ \
41663 float32x2_t __ret_185; \
41664 float32x2_t __s0_185 = __p0_185; \
41665 float32x2_t __s1_185 = __p1_185; \
41666 float32x2_t __s2_185 = __p2_185; \
41667float32x2_t __reint_185 = __s2_185; \
41668uint64x1_t __reint1_185 = (uint64x1_t) {vget_lane_u64(*(uint64x1_t *) &__reint_185, __p3_185)}; \
41669 __ret_185 = vcmla_rot270_f32(__s0_185, __s1_185, *(float32x2_t *) &__reint1_185); \
41670 __ret_185; \
41671})
42825__ai uint32x4_t vceqzq_f32(float32x4_t __p0) {
42826 uint32x4_t __ret;
42827 __ret = (uint32x4_t) __builtin_neon_vceqzq_v((int8x16_t)__p0, 50);
42828 return __ret;
42829}
4167242830#else
41673#define vcmla_rot270_lane_f32(__p0_186, __p1_186, __p2_186, __p3_186) __extension__ ({ \
41674 float32x2_t __ret_186; \
41675 float32x2_t __s0_186 = __p0_186; \
41676 float32x2_t __s1_186 = __p1_186; \
41677 float32x2_t __s2_186 = __p2_186; \
41678 float32x2_t __rev0_186; __rev0_186 = __builtin_shufflevector(__s0_186, __s0_186, 1, 0); \
41679 float32x2_t __rev1_186; __rev1_186 = __builtin_shufflevector(__s1_186, __s1_186, 1, 0); \
41680 float32x2_t __rev2_186; __rev2_186 = __builtin_shufflevector(__s2_186, __s2_186, 1, 0); \
41681float32x2_t __reint_186 = __rev2_186; \
41682uint64x1_t __reint1_186 = (uint64x1_t) {vget_lane_u64(*(uint64x1_t *) &__reint_186, __p3_186)}; \
41683 __ret_186 = __noswap_vcmla_rot270_f32(__rev0_186, __rev1_186, *(float32x2_t *) &__reint1_186); \
41684 __ret_186 = __builtin_shufflevector(__ret_186, __ret_186, 1, 0); \
41685 __ret_186; \
41686})
42831__ai uint32x4_t vceqzq_f32(float32x4_t __p0) {
42832 uint32x4_t __ret;
42833 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
42834 __ret = (uint32x4_t) __builtin_neon_vceqzq_v((int8x16_t)__rev0, 50);
42835 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
42836 return __ret;
42837}
4168742838#endif
4168842839
4168942840#ifdef __LITTLE_ENDIAN__
41690#define vcmlaq_rot270_lane_f32(__p0_187, __p1_187, __p2_187, __p3_187) __extension__ ({ \
41691 float32x4_t __ret_187; \
41692 float32x4_t __s0_187 = __p0_187; \
41693 float32x4_t __s1_187 = __p1_187; \
41694 float32x2_t __s2_187 = __p2_187; \
41695float32x2_t __reint_187 = __s2_187; \
41696uint64x2_t __reint1_187 = (uint64x2_t) {vget_lane_u64(*(uint64x1_t *) &__reint_187, __p3_187), vget_lane_u64(*(uint64x1_t *) &__reint_187, __p3_187)}; \
41697 __ret_187 = vcmlaq_rot270_f32(__s0_187, __s1_187, *(float32x4_t *) &__reint1_187); \
41698 __ret_187; \
41699})
42841__ai uint32x4_t vceqzq_s32(int32x4_t __p0) {
42842 uint32x4_t __ret;
42843 __ret = (uint32x4_t) __builtin_neon_vceqzq_v((int8x16_t)__p0, 50);
42844 return __ret;
42845}
4170042846#else
41701#define vcmlaq_rot270_lane_f32(__p0_188, __p1_188, __p2_188, __p3_188) __extension__ ({ \
41702 float32x4_t __ret_188; \
41703 float32x4_t __s0_188 = __p0_188; \
41704 float32x4_t __s1_188 = __p1_188; \
41705 float32x2_t __s2_188 = __p2_188; \
41706 float32x4_t __rev0_188; __rev0_188 = __builtin_shufflevector(__s0_188, __s0_188, 3, 2, 1, 0); \
41707 float32x4_t __rev1_188; __rev1_188 = __builtin_shufflevector(__s1_188, __s1_188, 3, 2, 1, 0); \
41708 float32x2_t __rev2_188; __rev2_188 = __builtin_shufflevector(__s2_188, __s2_188, 1, 0); \
41709float32x2_t __reint_188 = __rev2_188; \
41710uint64x2_t __reint1_188 = (uint64x2_t) {vget_lane_u64(*(uint64x1_t *) &__reint_188, __p3_188), vget_lane_u64(*(uint64x1_t *) &__reint_188, __p3_188)}; \
41711 __ret_188 = __noswap_vcmlaq_rot270_f32(__rev0_188, __rev1_188, *(float32x4_t *) &__reint1_188); \
41712 __ret_188 = __builtin_shufflevector(__ret_188, __ret_188, 3, 2, 1, 0); \
41713 __ret_188; \
41714})
42847__ai uint32x4_t vceqzq_s32(int32x4_t __p0) {
42848 uint32x4_t __ret;
42849 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
42850 __ret = (uint32x4_t) __builtin_neon_vceqzq_v((int8x16_t)__rev0, 50);
42851 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
42852 return __ret;
42853}
4171542854#endif
4171642855
4171742856#ifdef __LITTLE_ENDIAN__
41718#define vcmla_rot270_laneq_f32(__p0_189, __p1_189, __p2_189, __p3_189) __extension__ ({ \
41719 float32x2_t __ret_189; \
41720 float32x2_t __s0_189 = __p0_189; \
41721 float32x2_t __s1_189 = __p1_189; \
41722 float32x4_t __s2_189 = __p2_189; \
41723float32x4_t __reint_189 = __s2_189; \
41724uint64x1_t __reint1_189 = (uint64x1_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_189, __p3_189)}; \
41725 __ret_189 = vcmla_rot270_f32(__s0_189, __s1_189, *(float32x2_t *) &__reint1_189); \
41726 __ret_189; \
41727})
42857__ai uint64x2_t vceqzq_s64(int64x2_t __p0) {
42858 uint64x2_t __ret;
42859 __ret = (uint64x2_t) __builtin_neon_vceqzq_v((int8x16_t)__p0, 51);
42860 return __ret;
42861}
4172842862#else
41729#define vcmla_rot270_laneq_f32(__p0_190, __p1_190, __p2_190, __p3_190) __extension__ ({ \
41730 float32x2_t __ret_190; \
41731 float32x2_t __s0_190 = __p0_190; \
41732 float32x2_t __s1_190 = __p1_190; \
41733 float32x4_t __s2_190 = __p2_190; \
41734 float32x2_t __rev0_190; __rev0_190 = __builtin_shufflevector(__s0_190, __s0_190, 1, 0); \
41735 float32x2_t __rev1_190; __rev1_190 = __builtin_shufflevector(__s1_190, __s1_190, 1, 0); \
41736 float32x4_t __rev2_190; __rev2_190 = __builtin_shufflevector(__s2_190, __s2_190, 3, 2, 1, 0); \
41737float32x4_t __reint_190 = __rev2_190; \
41738uint64x1_t __reint1_190 = (uint64x1_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_190, __p3_190)}; \
41739 __ret_190 = __noswap_vcmla_rot270_f32(__rev0_190, __rev1_190, *(float32x2_t *) &__reint1_190); \
41740 __ret_190 = __builtin_shufflevector(__ret_190, __ret_190, 1, 0); \
41741 __ret_190; \
41742})
42863__ai uint64x2_t vceqzq_s64(int64x2_t __p0) {
42864 uint64x2_t __ret;
42865 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
42866 __ret = (uint64x2_t) __builtin_neon_vceqzq_v((int8x16_t)__rev0, 51);
42867 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
42868 return __ret;
42869}
4174342870#endif
4174442871
4174542872#ifdef __LITTLE_ENDIAN__
41746#define vcmlaq_rot270_laneq_f32(__p0_191, __p1_191, __p2_191, __p3_191) __extension__ ({ \
41747 float32x4_t __ret_191; \
41748 float32x4_t __s0_191 = __p0_191; \
41749 float32x4_t __s1_191 = __p1_191; \
41750 float32x4_t __s2_191 = __p2_191; \
41751float32x4_t __reint_191 = __s2_191; \
41752uint64x2_t __reint1_191 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_191, __p3_191), vgetq_lane_u64(*(uint64x2_t *) &__reint_191, __p3_191)}; \
41753 __ret_191 = vcmlaq_rot270_f32(__s0_191, __s1_191, *(float32x4_t *) &__reint1_191); \
41754 __ret_191; \
41755})
42873__ai uint16x8_t vceqzq_s16(int16x8_t __p0) {
42874 uint16x8_t __ret;
42875 __ret = (uint16x8_t) __builtin_neon_vceqzq_v((int8x16_t)__p0, 49);
42876 return __ret;
42877}
4175642878#else
41757#define vcmlaq_rot270_laneq_f32(__p0_192, __p1_192, __p2_192, __p3_192) __extension__ ({ \
41758 float32x4_t __ret_192; \
41759 float32x4_t __s0_192 = __p0_192; \
41760 float32x4_t __s1_192 = __p1_192; \
41761 float32x4_t __s2_192 = __p2_192; \
41762 float32x4_t __rev0_192; __rev0_192 = __builtin_shufflevector(__s0_192, __s0_192, 3, 2, 1, 0); \
41763 float32x4_t __rev1_192; __rev1_192 = __builtin_shufflevector(__s1_192, __s1_192, 3, 2, 1, 0); \
41764 float32x4_t __rev2_192; __rev2_192 = __builtin_shufflevector(__s2_192, __s2_192, 3, 2, 1, 0); \
41765float32x4_t __reint_192 = __rev2_192; \
41766uint64x2_t __reint1_192 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_192, __p3_192), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_192, __p3_192)}; \
41767 __ret_192 = __noswap_vcmlaq_rot270_f32(__rev0_192, __rev1_192, *(float32x4_t *) &__reint1_192); \
41768 __ret_192 = __builtin_shufflevector(__ret_192, __ret_192, 3, 2, 1, 0); \
41769 __ret_192; \
41770})
42879__ai uint16x8_t vceqzq_s16(int16x8_t __p0) {
42880 uint16x8_t __ret;
42881 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
42882 __ret = (uint16x8_t) __builtin_neon_vceqzq_v((int8x16_t)__rev0, 49);
42883 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
42884 return __ret;
42885}
4177142886#endif
4177242887
4177342888#ifdef __LITTLE_ENDIAN__
41774__ai float32x4_t vcmlaq_rot90_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
41775 float32x4_t __ret;
41776 __ret = (float32x4_t) __builtin_neon_vcmlaq_rot90_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
42889__ai uint8x8_t vceqz_u8(uint8x8_t __p0) {
42890 uint8x8_t __ret;
42891 __ret = (uint8x8_t) __builtin_neon_vceqz_v((int8x8_t)__p0, 16);
4177742892 return __ret;
4177842893}
4177942894#else
41780__ai float32x4_t vcmlaq_rot90_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
41781 float32x4_t __ret;
41782 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41783 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
41784 float32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
41785 __ret = (float32x4_t) __builtin_neon_vcmlaq_rot90_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 41);
41786 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
41787 return __ret;
41788}
41789__ai float32x4_t __noswap_vcmlaq_rot90_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
41790 float32x4_t __ret;
41791 __ret = (float32x4_t) __builtin_neon_vcmlaq_rot90_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
42895__ai uint8x8_t vceqz_u8(uint8x8_t __p0) {
42896 uint8x8_t __ret;
42897 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
42898 __ret = (uint8x8_t) __builtin_neon_vceqz_v((int8x8_t)__rev0, 16);
42899 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
4179242900 return __ret;
4179342901}
4179442902#endif
4179542903
4179642904#ifdef __LITTLE_ENDIAN__
41797__ai float32x2_t vcmla_rot90_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
41798 float32x2_t __ret;
41799 __ret = (float32x2_t) __builtin_neon_vcmla_rot90_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
42905__ai uint32x2_t vceqz_u32(uint32x2_t __p0) {
42906 uint32x2_t __ret;
42907 __ret = (uint32x2_t) __builtin_neon_vceqz_v((int8x8_t)__p0, 18);
4180042908 return __ret;
4180142909}
4180242910#else
41803__ai float32x2_t vcmla_rot90_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
41804 float32x2_t __ret;
41805 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
41806 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
41807 float32x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
41808 __ret = (float32x2_t) __builtin_neon_vcmla_rot90_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 9);
42911__ai uint32x2_t vceqz_u32(uint32x2_t __p0) {
42912 uint32x2_t __ret;
42913 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
42914 __ret = (uint32x2_t) __builtin_neon_vceqz_v((int8x8_t)__rev0, 18);
4180942915 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4181042916 return __ret;
4181142917}
41812__ai float32x2_t __noswap_vcmla_rot90_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
41813 float32x2_t __ret;
41814 __ret = (float32x2_t) __builtin_neon_vcmla_rot90_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
41815 return __ret;
41816}
4181742918#endif
4181842919
42920__ai uint64x1_t vceqz_u64(uint64x1_t __p0) {
42921 uint64x1_t __ret;
42922 __ret = (uint64x1_t) __builtin_neon_vceqz_v((int8x8_t)__p0, 19);
42923 return __ret;
42924}
4181942925#ifdef __LITTLE_ENDIAN__
41820#define vcmla_rot90_lane_f32(__p0_193, __p1_193, __p2_193, __p3_193) __extension__ ({ \
41821 float32x2_t __ret_193; \
41822 float32x2_t __s0_193 = __p0_193; \
41823 float32x2_t __s1_193 = __p1_193; \
41824 float32x2_t __s2_193 = __p2_193; \
41825float32x2_t __reint_193 = __s2_193; \
41826uint64x1_t __reint1_193 = (uint64x1_t) {vget_lane_u64(*(uint64x1_t *) &__reint_193, __p3_193)}; \
41827 __ret_193 = vcmla_rot90_f32(__s0_193, __s1_193, *(float32x2_t *) &__reint1_193); \
41828 __ret_193; \
41829})
42926__ai uint16x4_t vceqz_u16(uint16x4_t __p0) {
42927 uint16x4_t __ret;
42928 __ret = (uint16x4_t) __builtin_neon_vceqz_v((int8x8_t)__p0, 17);
42929 return __ret;
42930}
4183042931#else
41831#define vcmla_rot90_lane_f32(__p0_194, __p1_194, __p2_194, __p3_194) __extension__ ({ \
41832 float32x2_t __ret_194; \
41833 float32x2_t __s0_194 = __p0_194; \
41834 float32x2_t __s1_194 = __p1_194; \
41835 float32x2_t __s2_194 = __p2_194; \
41836 float32x2_t __rev0_194; __rev0_194 = __builtin_shufflevector(__s0_194, __s0_194, 1, 0); \
41837 float32x2_t __rev1_194; __rev1_194 = __builtin_shufflevector(__s1_194, __s1_194, 1, 0); \
41838 float32x2_t __rev2_194; __rev2_194 = __builtin_shufflevector(__s2_194, __s2_194, 1, 0); \
41839float32x2_t __reint_194 = __rev2_194; \
41840uint64x1_t __reint1_194 = (uint64x1_t) {vget_lane_u64(*(uint64x1_t *) &__reint_194, __p3_194)}; \
41841 __ret_194 = __noswap_vcmla_rot90_f32(__rev0_194, __rev1_194, *(float32x2_t *) &__reint1_194); \
41842 __ret_194 = __builtin_shufflevector(__ret_194, __ret_194, 1, 0); \
41843 __ret_194; \
41844})
42932__ai uint16x4_t vceqz_u16(uint16x4_t __p0) {
42933 uint16x4_t __ret;
42934 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
42935 __ret = (uint16x4_t) __builtin_neon_vceqz_v((int8x8_t)__rev0, 17);
42936 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
42937 return __ret;
42938}
4184542939#endif
4184642940
4184742941#ifdef __LITTLE_ENDIAN__
41848#define vcmlaq_rot90_lane_f32(__p0_195, __p1_195, __p2_195, __p3_195) __extension__ ({ \
41849 float32x4_t __ret_195; \
41850 float32x4_t __s0_195 = __p0_195; \
41851 float32x4_t __s1_195 = __p1_195; \
41852 float32x2_t __s2_195 = __p2_195; \
41853float32x2_t __reint_195 = __s2_195; \
41854uint64x2_t __reint1_195 = (uint64x2_t) {vget_lane_u64(*(uint64x1_t *) &__reint_195, __p3_195), vget_lane_u64(*(uint64x1_t *) &__reint_195, __p3_195)}; \
41855 __ret_195 = vcmlaq_rot90_f32(__s0_195, __s1_195, *(float32x4_t *) &__reint1_195); \
41856 __ret_195; \
41857})
42942__ai uint8x8_t vceqz_s8(int8x8_t __p0) {
42943 uint8x8_t __ret;
42944 __ret = (uint8x8_t) __builtin_neon_vceqz_v((int8x8_t)__p0, 16);
42945 return __ret;
42946}
4185842947#else
41859#define vcmlaq_rot90_lane_f32(__p0_196, __p1_196, __p2_196, __p3_196) __extension__ ({ \
41860 float32x4_t __ret_196; \
41861 float32x4_t __s0_196 = __p0_196; \
41862 float32x4_t __s1_196 = __p1_196; \
41863 float32x2_t __s2_196 = __p2_196; \
41864 float32x4_t __rev0_196; __rev0_196 = __builtin_shufflevector(__s0_196, __s0_196, 3, 2, 1, 0); \
41865 float32x4_t __rev1_196; __rev1_196 = __builtin_shufflevector(__s1_196, __s1_196, 3, 2, 1, 0); \
41866 float32x2_t __rev2_196; __rev2_196 = __builtin_shufflevector(__s2_196, __s2_196, 1, 0); \
41867float32x2_t __reint_196 = __rev2_196; \
41868uint64x2_t __reint1_196 = (uint64x2_t) {vget_lane_u64(*(uint64x1_t *) &__reint_196, __p3_196), vget_lane_u64(*(uint64x1_t *) &__reint_196, __p3_196)}; \
41869 __ret_196 = __noswap_vcmlaq_rot90_f32(__rev0_196, __rev1_196, *(float32x4_t *) &__reint1_196); \
41870 __ret_196 = __builtin_shufflevector(__ret_196, __ret_196, 3, 2, 1, 0); \
41871 __ret_196; \
41872})
42948__ai uint8x8_t vceqz_s8(int8x8_t __p0) {
42949 uint8x8_t __ret;
42950 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
42951 __ret = (uint8x8_t) __builtin_neon_vceqz_v((int8x8_t)__rev0, 16);
42952 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
42953 return __ret;
42954}
4187342955#endif
4187442956
42957__ai uint64x1_t vceqz_f64(float64x1_t __p0) {
42958 uint64x1_t __ret;
42959 __ret = (uint64x1_t) __builtin_neon_vceqz_v((int8x8_t)__p0, 19);
42960 return __ret;
42961}
4187542962#ifdef __LITTLE_ENDIAN__
41876#define vcmla_rot90_laneq_f32(__p0_197, __p1_197, __p2_197, __p3_197) __extension__ ({ \
41877 float32x2_t __ret_197; \
41878 float32x2_t __s0_197 = __p0_197; \
41879 float32x2_t __s1_197 = __p1_197; \
41880 float32x4_t __s2_197 = __p2_197; \
41881float32x4_t __reint_197 = __s2_197; \
41882uint64x1_t __reint1_197 = (uint64x1_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_197, __p3_197)}; \
41883 __ret_197 = vcmla_rot90_f32(__s0_197, __s1_197, *(float32x2_t *) &__reint1_197); \
41884 __ret_197; \
41885})
42963__ai uint32x2_t vceqz_f32(float32x2_t __p0) {
42964 uint32x2_t __ret;
42965 __ret = (uint32x2_t) __builtin_neon_vceqz_v((int8x8_t)__p0, 18);
42966 return __ret;
42967}
4188642968#else
41887#define vcmla_rot90_laneq_f32(__p0_198, __p1_198, __p2_198, __p3_198) __extension__ ({ \
41888 float32x2_t __ret_198; \
41889 float32x2_t __s0_198 = __p0_198; \
41890 float32x2_t __s1_198 = __p1_198; \
41891 float32x4_t __s2_198 = __p2_198; \
41892 float32x2_t __rev0_198; __rev0_198 = __builtin_shufflevector(__s0_198, __s0_198, 1, 0); \
41893 float32x2_t __rev1_198; __rev1_198 = __builtin_shufflevector(__s1_198, __s1_198, 1, 0); \
41894 float32x4_t __rev2_198; __rev2_198 = __builtin_shufflevector(__s2_198, __s2_198, 3, 2, 1, 0); \
41895float32x4_t __reint_198 = __rev2_198; \
41896uint64x1_t __reint1_198 = (uint64x1_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_198, __p3_198)}; \
41897 __ret_198 = __noswap_vcmla_rot90_f32(__rev0_198, __rev1_198, *(float32x2_t *) &__reint1_198); \
41898 __ret_198 = __builtin_shufflevector(__ret_198, __ret_198, 1, 0); \
41899 __ret_198; \
41900})
42969__ai uint32x2_t vceqz_f32(float32x2_t __p0) {
42970 uint32x2_t __ret;
42971 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
42972 __ret = (uint32x2_t) __builtin_neon_vceqz_v((int8x8_t)__rev0, 18);
42973 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
42974 return __ret;
42975}
4190142976#endif
4190242977
4190342978#ifdef __LITTLE_ENDIAN__
41904#define vcmlaq_rot90_laneq_f32(__p0_199, __p1_199, __p2_199, __p3_199) __extension__ ({ \
41905 float32x4_t __ret_199; \
41906 float32x4_t __s0_199 = __p0_199; \
41907 float32x4_t __s1_199 = __p1_199; \
41908 float32x4_t __s2_199 = __p2_199; \
41909float32x4_t __reint_199 = __s2_199; \
41910uint64x2_t __reint1_199 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_199, __p3_199), vgetq_lane_u64(*(uint64x2_t *) &__reint_199, __p3_199)}; \
41911 __ret_199 = vcmlaq_rot90_f32(__s0_199, __s1_199, *(float32x4_t *) &__reint1_199); \
41912 __ret_199; \
41913})
42979__ai uint32x2_t vceqz_s32(int32x2_t __p0) {
42980 uint32x2_t __ret;
42981 __ret = (uint32x2_t) __builtin_neon_vceqz_v((int8x8_t)__p0, 18);
42982 return __ret;
42983}
4191442984#else
41915#define vcmlaq_rot90_laneq_f32(__p0_200, __p1_200, __p2_200, __p3_200) __extension__ ({ \
41916 float32x4_t __ret_200; \
41917 float32x4_t __s0_200 = __p0_200; \
41918 float32x4_t __s1_200 = __p1_200; \
41919 float32x4_t __s2_200 = __p2_200; \
41920 float32x4_t __rev0_200; __rev0_200 = __builtin_shufflevector(__s0_200, __s0_200, 3, 2, 1, 0); \
41921 float32x4_t __rev1_200; __rev1_200 = __builtin_shufflevector(__s1_200, __s1_200, 3, 2, 1, 0); \
41922 float32x4_t __rev2_200; __rev2_200 = __builtin_shufflevector(__s2_200, __s2_200, 3, 2, 1, 0); \
41923float32x4_t __reint_200 = __rev2_200; \
41924uint64x2_t __reint1_200 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_200, __p3_200), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_200, __p3_200)}; \
41925 __ret_200 = __noswap_vcmlaq_rot90_f32(__rev0_200, __rev1_200, *(float32x4_t *) &__reint1_200); \
41926 __ret_200 = __builtin_shufflevector(__ret_200, __ret_200, 3, 2, 1, 0); \
41927 __ret_200; \
41928})
42985__ai uint32x2_t vceqz_s32(int32x2_t __p0) {
42986 uint32x2_t __ret;
42987 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
42988 __ret = (uint32x2_t) __builtin_neon_vceqz_v((int8x8_t)__rev0, 18);
42989 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
42990 return __ret;
42991}
4192942992#endif
4193042993
41931#endif
41932#if defined(__ARM_FEATURE_COMPLEX) && defined(__ARM_FEATURE_FP16_VECTOR_ARITHMETIC)
42994__ai uint64x1_t vceqz_s64(int64x1_t __p0) {
42995 uint64x1_t __ret;
42996 __ret = (uint64x1_t) __builtin_neon_vceqz_v((int8x8_t)__p0, 19);
42997 return __ret;
42998}
4193342999#ifdef __LITTLE_ENDIAN__
41934__ai float16x4_t vcadd_rot270_f16(float16x4_t __p0, float16x4_t __p1) {
41935 float16x4_t __ret;
41936 __ret = (float16x4_t) __builtin_neon_vcadd_rot270_v((int8x8_t)__p0, (int8x8_t)__p1, 8);
43000__ai uint16x4_t vceqz_s16(int16x4_t __p0) {
43001 uint16x4_t __ret;
43002 __ret = (uint16x4_t) __builtin_neon_vceqz_v((int8x8_t)__p0, 17);
4193743003 return __ret;
4193843004}
4193943005#else
41940__ai float16x4_t vcadd_rot270_f16(float16x4_t __p0, float16x4_t __p1) {
41941 float16x4_t __ret;
41942 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41943 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
41944 __ret = (float16x4_t) __builtin_neon_vcadd_rot270_v((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
43006__ai uint16x4_t vceqz_s16(int16x4_t __p0) {
43007 uint16x4_t __ret;
43008 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
43009 __ret = (uint16x4_t) __builtin_neon_vceqz_v((int8x8_t)__rev0, 17);
4194543010 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
4194643011 return __ret;
4194743012}
41948#endif
41949
41950#ifdef __LITTLE_ENDIAN__
41951__ai float16x4_t vcadd_rot90_f16(float16x4_t __p0, float16x4_t __p1) {
41952 float16x4_t __ret;
41953 __ret = (float16x4_t) __builtin_neon_vcadd_rot90_v((int8x8_t)__p0, (int8x8_t)__p1, 8);
43013#endif
43014
43015__ai uint64_t vceqzd_u64(uint64_t __p0) {
43016 uint64_t __ret;
43017 __ret = (uint64_t) __builtin_neon_vceqzd_u64(__p0);
43018 return __ret;
43019}
43020__ai uint64_t vceqzd_s64(int64_t __p0) {
43021 uint64_t __ret;
43022 __ret = (uint64_t) __builtin_neon_vceqzd_s64(__p0);
43023 return __ret;
43024}
43025__ai uint64_t vceqzd_f64(float64_t __p0) {
43026 uint64_t __ret;
43027 __ret = (uint64_t) __builtin_neon_vceqzd_f64(__p0);
4195443028 return __ret;
4195543029}
41956#else
41957__ai float16x4_t vcadd_rot90_f16(float16x4_t __p0, float16x4_t __p1) {
41958 float16x4_t __ret;
41959 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
41960 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
41961 __ret = (float16x4_t) __builtin_neon_vcadd_rot90_v((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
41962 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
43030__ai uint32_t vceqzs_f32(float32_t __p0) {
43031 uint32_t __ret;
43032 __ret = (uint32_t) __builtin_neon_vceqzs_f32(__p0);
4196343033 return __ret;
4196443034}
41965#endif
41966
4196743035#ifdef __LITTLE_ENDIAN__
41968__ai float16x8_t vcaddq_rot270_f16(float16x8_t __p0, float16x8_t __p1) {
41969 float16x8_t __ret;
41970 __ret = (float16x8_t) __builtin_neon_vcaddq_rot270_v((int8x16_t)__p0, (int8x16_t)__p1, 40);
43036__ai uint64x2_t vcgeq_u64(uint64x2_t __p0, uint64x2_t __p1) {
43037 uint64x2_t __ret;
43038 __ret = (uint64x2_t)(__p0 >= __p1);
4197143039 return __ret;
4197243040}
4197343041#else
41974__ai float16x8_t vcaddq_rot270_f16(float16x8_t __p0, float16x8_t __p1) {
41975 float16x8_t __ret;
41976 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
41977 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
41978 __ret = (float16x8_t) __builtin_neon_vcaddq_rot270_v((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
41979 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
43042__ai uint64x2_t vcgeq_u64(uint64x2_t __p0, uint64x2_t __p1) {
43043 uint64x2_t __ret;
43044 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43045 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
43046 __ret = (uint64x2_t)(__rev0 >= __rev1);
43047 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4198043048 return __ret;
4198143049}
4198243050#endif
4198343051
4198443052#ifdef __LITTLE_ENDIAN__
41985__ai float16x8_t vcaddq_rot90_f16(float16x8_t __p0, float16x8_t __p1) {
41986 float16x8_t __ret;
41987 __ret = (float16x8_t) __builtin_neon_vcaddq_rot90_v((int8x16_t)__p0, (int8x16_t)__p1, 40);
43053__ai uint64x2_t vcgeq_f64(float64x2_t __p0, float64x2_t __p1) {
43054 uint64x2_t __ret;
43055 __ret = (uint64x2_t)(__p0 >= __p1);
4198843056 return __ret;
4198943057}
4199043058#else
41991__ai float16x8_t vcaddq_rot90_f16(float16x8_t __p0, float16x8_t __p1) {
41992 float16x8_t __ret;
41993 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
41994 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
41995 __ret = (float16x8_t) __builtin_neon_vcaddq_rot90_v((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
41996 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
43059__ai uint64x2_t vcgeq_f64(float64x2_t __p0, float64x2_t __p1) {
43060 uint64x2_t __ret;
43061 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43062 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
43063 __ret = (uint64x2_t)(__rev0 >= __rev1);
43064 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4199743065 return __ret;
4199843066}
4199943067#endif
4200043068
4200143069#ifdef __LITTLE_ENDIAN__
42002__ai float16x8_t vcmlaq_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
42003 float16x8_t __ret;
42004 __ret = (float16x8_t) __builtin_neon_vcmlaq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 40);
43070__ai uint64x2_t vcgeq_s64(int64x2_t __p0, int64x2_t __p1) {
43071 uint64x2_t __ret;
43072 __ret = (uint64x2_t)(__p0 >= __p1);
4200543073 return __ret;
4200643074}
4200743075#else
42008__ai float16x8_t vcmlaq_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
42009 float16x8_t __ret;
42010 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
42011 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
42012 float16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
42013 __ret = (float16x8_t) __builtin_neon_vcmlaq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 40);
42014 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
42015 return __ret;
42016}
42017__ai float16x8_t __noswap_vcmlaq_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
42018 float16x8_t __ret;
42019 __ret = (float16x8_t) __builtin_neon_vcmlaq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 40);
43076__ai uint64x2_t vcgeq_s64(int64x2_t __p0, int64x2_t __p1) {
43077 uint64x2_t __ret;
43078 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43079 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
43080 __ret = (uint64x2_t)(__rev0 >= __rev1);
43081 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4202043082 return __ret;
4202143083}
4202243084#endif
4202343085
42024#ifdef __LITTLE_ENDIAN__
42025__ai float16x4_t vcmla_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
42026 float16x4_t __ret;
42027 __ret = (float16x4_t) __builtin_neon_vcmla_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 8);
43086__ai uint64x1_t vcge_u64(uint64x1_t __p0, uint64x1_t __p1) {
43087 uint64x1_t __ret;
43088 __ret = (uint64x1_t)(__p0 >= __p1);
4202843089 return __ret;
4202943090}
42030#else
42031__ai float16x4_t vcmla_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
42032 float16x4_t __ret;
42033 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
42034 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
42035 float16x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
42036 __ret = (float16x4_t) __builtin_neon_vcmla_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 8);
42037 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
43091__ai uint64x1_t vcge_f64(float64x1_t __p0, float64x1_t __p1) {
43092 uint64x1_t __ret;
43093 __ret = (uint64x1_t)(__p0 >= __p1);
4203843094 return __ret;
4203943095}
42040__ai float16x4_t __noswap_vcmla_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
42041 float16x4_t __ret;
42042 __ret = (float16x4_t) __builtin_neon_vcmla_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 8);
43096__ai uint64x1_t vcge_s64(int64x1_t __p0, int64x1_t __p1) {
43097 uint64x1_t __ret;
43098 __ret = (uint64x1_t)(__p0 >= __p1);
4204343099 return __ret;
4204443100}
42045#endif
42046
42047#ifdef __LITTLE_ENDIAN__
42048#define vcmla_lane_f16(__p0_201, __p1_201, __p2_201, __p3_201) __extension__ ({ \
42049 float16x4_t __ret_201; \
42050 float16x4_t __s0_201 = __p0_201; \
42051 float16x4_t __s1_201 = __p1_201; \
42052 float16x4_t __s2_201 = __p2_201; \
42053float16x4_t __reint_201 = __s2_201; \
42054uint32x2_t __reint1_201 = (uint32x2_t) {vget_lane_u32(*(uint32x2_t *) &__reint_201, __p3_201), vget_lane_u32(*(uint32x2_t *) &__reint_201, __p3_201)}; \
42055 __ret_201 = vcmla_f16(__s0_201, __s1_201, *(float16x4_t *) &__reint1_201); \
42056 __ret_201; \
42057})
42058#else
42059#define vcmla_lane_f16(__p0_202, __p1_202, __p2_202, __p3_202) __extension__ ({ \
42060 float16x4_t __ret_202; \
42061 float16x4_t __s0_202 = __p0_202; \
42062 float16x4_t __s1_202 = __p1_202; \
42063 float16x4_t __s2_202 = __p2_202; \
42064 float16x4_t __rev0_202; __rev0_202 = __builtin_shufflevector(__s0_202, __s0_202, 3, 2, 1, 0); \
42065 float16x4_t __rev1_202; __rev1_202 = __builtin_shufflevector(__s1_202, __s1_202, 3, 2, 1, 0); \
42066 float16x4_t __rev2_202; __rev2_202 = __builtin_shufflevector(__s2_202, __s2_202, 3, 2, 1, 0); \
42067float16x4_t __reint_202 = __rev2_202; \
42068uint32x2_t __reint1_202 = (uint32x2_t) {__noswap_vget_lane_u32(*(uint32x2_t *) &__reint_202, __p3_202), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_202, __p3_202)}; \
42069 __ret_202 = __noswap_vcmla_f16(__rev0_202, __rev1_202, *(float16x4_t *) &__reint1_202); \
42070 __ret_202 = __builtin_shufflevector(__ret_202, __ret_202, 3, 2, 1, 0); \
42071 __ret_202; \
42072})
42073#endif
42074
42075#ifdef __LITTLE_ENDIAN__
42076#define vcmlaq_lane_f16(__p0_203, __p1_203, __p2_203, __p3_203) __extension__ ({ \
42077 float16x8_t __ret_203; \
42078 float16x8_t __s0_203 = __p0_203; \
42079 float16x8_t __s1_203 = __p1_203; \
42080 float16x4_t __s2_203 = __p2_203; \
42081float16x4_t __reint_203 = __s2_203; \
42082uint32x4_t __reint1_203 = (uint32x4_t) {vget_lane_u32(*(uint32x2_t *) &__reint_203, __p3_203), vget_lane_u32(*(uint32x2_t *) &__reint_203, __p3_203), vget_lane_u32(*(uint32x2_t *) &__reint_203, __p3_203), vget_lane_u32(*(uint32x2_t *) &__reint_203, __p3_203)}; \
42083 __ret_203 = vcmlaq_f16(__s0_203, __s1_203, *(float16x8_t *) &__reint1_203); \
42084 __ret_203; \
42085})
42086#else
42087#define vcmlaq_lane_f16(__p0_204, __p1_204, __p2_204, __p3_204) __extension__ ({ \
42088 float16x8_t __ret_204; \
42089 float16x8_t __s0_204 = __p0_204; \
42090 float16x8_t __s1_204 = __p1_204; \
42091 float16x4_t __s2_204 = __p2_204; \
42092 float16x8_t __rev0_204; __rev0_204 = __builtin_shufflevector(__s0_204, __s0_204, 7, 6, 5, 4, 3, 2, 1, 0); \
42093 float16x8_t __rev1_204; __rev1_204 = __builtin_shufflevector(__s1_204, __s1_204, 7, 6, 5, 4, 3, 2, 1, 0); \
42094 float16x4_t __rev2_204; __rev2_204 = __builtin_shufflevector(__s2_204, __s2_204, 3, 2, 1, 0); \
42095float16x4_t __reint_204 = __rev2_204; \
42096uint32x4_t __reint1_204 = (uint32x4_t) {__noswap_vget_lane_u32(*(uint32x2_t *) &__reint_204, __p3_204), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_204, __p3_204), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_204, __p3_204), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_204, __p3_204)}; \
42097 __ret_204 = __noswap_vcmlaq_f16(__rev0_204, __rev1_204, *(float16x8_t *) &__reint1_204); \
42098 __ret_204 = __builtin_shufflevector(__ret_204, __ret_204, 7, 6, 5, 4, 3, 2, 1, 0); \
42099 __ret_204; \
42100})
42101#endif
42102
42103#ifdef __LITTLE_ENDIAN__
42104#define vcmla_laneq_f16(__p0_205, __p1_205, __p2_205, __p3_205) __extension__ ({ \
42105 float16x4_t __ret_205; \
42106 float16x4_t __s0_205 = __p0_205; \
42107 float16x4_t __s1_205 = __p1_205; \
42108 float16x8_t __s2_205 = __p2_205; \
42109float16x8_t __reint_205 = __s2_205; \
42110uint32x2_t __reint1_205 = (uint32x2_t) {vgetq_lane_u32(*(uint32x4_t *) &__reint_205, __p3_205), vgetq_lane_u32(*(uint32x4_t *) &__reint_205, __p3_205)}; \
42111 __ret_205 = vcmla_f16(__s0_205, __s1_205, *(float16x4_t *) &__reint1_205); \
42112 __ret_205; \
42113})
42114#else
42115#define vcmla_laneq_f16(__p0_206, __p1_206, __p2_206, __p3_206) __extension__ ({ \
42116 float16x4_t __ret_206; \
42117 float16x4_t __s0_206 = __p0_206; \
42118 float16x4_t __s1_206 = __p1_206; \
42119 float16x8_t __s2_206 = __p2_206; \
42120 float16x4_t __rev0_206; __rev0_206 = __builtin_shufflevector(__s0_206, __s0_206, 3, 2, 1, 0); \
42121 float16x4_t __rev1_206; __rev1_206 = __builtin_shufflevector(__s1_206, __s1_206, 3, 2, 1, 0); \
42122 float16x8_t __rev2_206; __rev2_206 = __builtin_shufflevector(__s2_206, __s2_206, 7, 6, 5, 4, 3, 2, 1, 0); \
42123float16x8_t __reint_206 = __rev2_206; \
42124uint32x2_t __reint1_206 = (uint32x2_t) {__noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_206, __p3_206), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_206, __p3_206)}; \
42125 __ret_206 = __noswap_vcmla_f16(__rev0_206, __rev1_206, *(float16x4_t *) &__reint1_206); \
42126 __ret_206 = __builtin_shufflevector(__ret_206, __ret_206, 3, 2, 1, 0); \
42127 __ret_206; \
42128})
42129#endif
42130
42131#ifdef __LITTLE_ENDIAN__
42132#define vcmlaq_laneq_f16(__p0_207, __p1_207, __p2_207, __p3_207) __extension__ ({ \
42133 float16x8_t __ret_207; \
42134 float16x8_t __s0_207 = __p0_207; \
42135 float16x8_t __s1_207 = __p1_207; \
42136 float16x8_t __s2_207 = __p2_207; \
42137float16x8_t __reint_207 = __s2_207; \
42138uint32x4_t __reint1_207 = (uint32x4_t) {vgetq_lane_u32(*(uint32x4_t *) &__reint_207, __p3_207), vgetq_lane_u32(*(uint32x4_t *) &__reint_207, __p3_207), vgetq_lane_u32(*(uint32x4_t *) &__reint_207, __p3_207), vgetq_lane_u32(*(uint32x4_t *) &__reint_207, __p3_207)}; \
42139 __ret_207 = vcmlaq_f16(__s0_207, __s1_207, *(float16x8_t *) &__reint1_207); \
42140 __ret_207; \
42141})
42142#else
42143#define vcmlaq_laneq_f16(__p0_208, __p1_208, __p2_208, __p3_208) __extension__ ({ \
42144 float16x8_t __ret_208; \
42145 float16x8_t __s0_208 = __p0_208; \
42146 float16x8_t __s1_208 = __p1_208; \
42147 float16x8_t __s2_208 = __p2_208; \
42148 float16x8_t __rev0_208; __rev0_208 = __builtin_shufflevector(__s0_208, __s0_208, 7, 6, 5, 4, 3, 2, 1, 0); \
42149 float16x8_t __rev1_208; __rev1_208 = __builtin_shufflevector(__s1_208, __s1_208, 7, 6, 5, 4, 3, 2, 1, 0); \
42150 float16x8_t __rev2_208; __rev2_208 = __builtin_shufflevector(__s2_208, __s2_208, 7, 6, 5, 4, 3, 2, 1, 0); \
42151float16x8_t __reint_208 = __rev2_208; \
42152uint32x4_t __reint1_208 = (uint32x4_t) {__noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_208, __p3_208), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_208, __p3_208), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_208, __p3_208), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_208, __p3_208)}; \
42153 __ret_208 = __noswap_vcmlaq_f16(__rev0_208, __rev1_208, *(float16x8_t *) &__reint1_208); \
42154 __ret_208 = __builtin_shufflevector(__ret_208, __ret_208, 7, 6, 5, 4, 3, 2, 1, 0); \
42155 __ret_208; \
42156})
42157#endif
42158
42159#ifdef __LITTLE_ENDIAN__
42160__ai float16x8_t vcmlaq_rot180_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
42161 float16x8_t __ret;
42162 __ret = (float16x8_t) __builtin_neon_vcmlaq_rot180_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 40);
43101__ai uint64_t vcged_s64(int64_t __p0, int64_t __p1) {
43102 uint64_t __ret;
43103 __ret = (uint64_t) __builtin_neon_vcged_s64(__p0, __p1);
4216343104 return __ret;
4216443105}
42165#else
42166__ai float16x8_t vcmlaq_rot180_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
42167 float16x8_t __ret;
42168 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
42169 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
42170 float16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
42171 __ret = (float16x8_t) __builtin_neon_vcmlaq_rot180_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 40);
42172 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
43106__ai uint64_t vcged_u64(uint64_t __p0, uint64_t __p1) {
43107 uint64_t __ret;
43108 __ret = (uint64_t) __builtin_neon_vcged_u64(__p0, __p1);
4217343109 return __ret;
4217443110}
42175__ai float16x8_t __noswap_vcmlaq_rot180_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
42176 float16x8_t __ret;
42177 __ret = (float16x8_t) __builtin_neon_vcmlaq_rot180_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 40);
43111__ai uint64_t vcged_f64(float64_t __p0, float64_t __p1) {
43112 uint64_t __ret;
43113 __ret = (uint64_t) __builtin_neon_vcged_f64(__p0, __p1);
4217843114 return __ret;
4217943115}
42180#endif
42181
42182#ifdef __LITTLE_ENDIAN__
42183__ai float16x4_t vcmla_rot180_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
42184 float16x4_t __ret;
42185 __ret = (float16x4_t) __builtin_neon_vcmla_rot180_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 8);
43116__ai uint32_t vcges_f32(float32_t __p0, float32_t __p1) {
43117 uint32_t __ret;
43118 __ret = (uint32_t) __builtin_neon_vcges_f32(__p0, __p1);
4218643119 return __ret;
4218743120}
42188#else
42189__ai float16x4_t vcmla_rot180_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
42190 float16x4_t __ret;
42191 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
42192 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
42193 float16x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
42194 __ret = (float16x4_t) __builtin_neon_vcmla_rot180_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 8);
42195 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
43121#ifdef __LITTLE_ENDIAN__
43122__ai uint8x16_t vcgezq_s8(int8x16_t __p0) {
43123 uint8x16_t __ret;
43124 __ret = (uint8x16_t) __builtin_neon_vcgezq_v((int8x16_t)__p0, 48);
4219643125 return __ret;
4219743126}
42198__ai float16x4_t __noswap_vcmla_rot180_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
42199 float16x4_t __ret;
42200 __ret = (float16x4_t) __builtin_neon_vcmla_rot180_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 8);
43127#else
43128__ai uint8x16_t vcgezq_s8(int8x16_t __p0) {
43129 uint8x16_t __ret;
43130 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
43131 __ret = (uint8x16_t) __builtin_neon_vcgezq_v((int8x16_t)__rev0, 48);
43132 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
4220143133 return __ret;
4220243134}
4220343135#endif
4220443136
4220543137#ifdef __LITTLE_ENDIAN__
42206#define vcmla_rot180_lane_f16(__p0_209, __p1_209, __p2_209, __p3_209) __extension__ ({ \
42207 float16x4_t __ret_209; \
42208 float16x4_t __s0_209 = __p0_209; \
42209 float16x4_t __s1_209 = __p1_209; \
42210 float16x4_t __s2_209 = __p2_209; \
42211float16x4_t __reint_209 = __s2_209; \
42212uint32x2_t __reint1_209 = (uint32x2_t) {vget_lane_u32(*(uint32x2_t *) &__reint_209, __p3_209), vget_lane_u32(*(uint32x2_t *) &__reint_209, __p3_209)}; \
42213 __ret_209 = vcmla_rot180_f16(__s0_209, __s1_209, *(float16x4_t *) &__reint1_209); \
42214 __ret_209; \
42215})
42216#else
42217#define vcmla_rot180_lane_f16(__p0_210, __p1_210, __p2_210, __p3_210) __extension__ ({ \
42218 float16x4_t __ret_210; \
42219 float16x4_t __s0_210 = __p0_210; \
42220 float16x4_t __s1_210 = __p1_210; \
42221 float16x4_t __s2_210 = __p2_210; \
42222 float16x4_t __rev0_210; __rev0_210 = __builtin_shufflevector(__s0_210, __s0_210, 3, 2, 1, 0); \
42223 float16x4_t __rev1_210; __rev1_210 = __builtin_shufflevector(__s1_210, __s1_210, 3, 2, 1, 0); \
42224 float16x4_t __rev2_210; __rev2_210 = __builtin_shufflevector(__s2_210, __s2_210, 3, 2, 1, 0); \
42225float16x4_t __reint_210 = __rev2_210; \
42226uint32x2_t __reint1_210 = (uint32x2_t) {__noswap_vget_lane_u32(*(uint32x2_t *) &__reint_210, __p3_210), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_210, __p3_210)}; \
42227 __ret_210 = __noswap_vcmla_rot180_f16(__rev0_210, __rev1_210, *(float16x4_t *) &__reint1_210); \
42228 __ret_210 = __builtin_shufflevector(__ret_210, __ret_210, 3, 2, 1, 0); \
42229 __ret_210; \
42230})
42231#endif
42232
42233#ifdef __LITTLE_ENDIAN__
42234#define vcmlaq_rot180_lane_f16(__p0_211, __p1_211, __p2_211, __p3_211) __extension__ ({ \
42235 float16x8_t __ret_211; \
42236 float16x8_t __s0_211 = __p0_211; \
42237 float16x8_t __s1_211 = __p1_211; \
42238 float16x4_t __s2_211 = __p2_211; \
42239float16x4_t __reint_211 = __s2_211; \
42240uint32x4_t __reint1_211 = (uint32x4_t) {vget_lane_u32(*(uint32x2_t *) &__reint_211, __p3_211), vget_lane_u32(*(uint32x2_t *) &__reint_211, __p3_211), vget_lane_u32(*(uint32x2_t *) &__reint_211, __p3_211), vget_lane_u32(*(uint32x2_t *) &__reint_211, __p3_211)}; \
42241 __ret_211 = vcmlaq_rot180_f16(__s0_211, __s1_211, *(float16x8_t *) &__reint1_211); \
42242 __ret_211; \
42243})
42244#else
42245#define vcmlaq_rot180_lane_f16(__p0_212, __p1_212, __p2_212, __p3_212) __extension__ ({ \
42246 float16x8_t __ret_212; \
42247 float16x8_t __s0_212 = __p0_212; \
42248 float16x8_t __s1_212 = __p1_212; \
42249 float16x4_t __s2_212 = __p2_212; \
42250 float16x8_t __rev0_212; __rev0_212 = __builtin_shufflevector(__s0_212, __s0_212, 7, 6, 5, 4, 3, 2, 1, 0); \
42251 float16x8_t __rev1_212; __rev1_212 = __builtin_shufflevector(__s1_212, __s1_212, 7, 6, 5, 4, 3, 2, 1, 0); \
42252 float16x4_t __rev2_212; __rev2_212 = __builtin_shufflevector(__s2_212, __s2_212, 3, 2, 1, 0); \
42253float16x4_t __reint_212 = __rev2_212; \
42254uint32x4_t __reint1_212 = (uint32x4_t) {__noswap_vget_lane_u32(*(uint32x2_t *) &__reint_212, __p3_212), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_212, __p3_212), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_212, __p3_212), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_212, __p3_212)}; \
42255 __ret_212 = __noswap_vcmlaq_rot180_f16(__rev0_212, __rev1_212, *(float16x8_t *) &__reint1_212); \
42256 __ret_212 = __builtin_shufflevector(__ret_212, __ret_212, 7, 6, 5, 4, 3, 2, 1, 0); \
42257 __ret_212; \
42258})
42259#endif
42260
42261#ifdef __LITTLE_ENDIAN__
42262#define vcmla_rot180_laneq_f16(__p0_213, __p1_213, __p2_213, __p3_213) __extension__ ({ \
42263 float16x4_t __ret_213; \
42264 float16x4_t __s0_213 = __p0_213; \
42265 float16x4_t __s1_213 = __p1_213; \
42266 float16x8_t __s2_213 = __p2_213; \
42267float16x8_t __reint_213 = __s2_213; \
42268uint32x2_t __reint1_213 = (uint32x2_t) {vgetq_lane_u32(*(uint32x4_t *) &__reint_213, __p3_213), vgetq_lane_u32(*(uint32x4_t *) &__reint_213, __p3_213)}; \
42269 __ret_213 = vcmla_rot180_f16(__s0_213, __s1_213, *(float16x4_t *) &__reint1_213); \
42270 __ret_213; \
42271})
42272#else
42273#define vcmla_rot180_laneq_f16(__p0_214, __p1_214, __p2_214, __p3_214) __extension__ ({ \
42274 float16x4_t __ret_214; \
42275 float16x4_t __s0_214 = __p0_214; \
42276 float16x4_t __s1_214 = __p1_214; \
42277 float16x8_t __s2_214 = __p2_214; \
42278 float16x4_t __rev0_214; __rev0_214 = __builtin_shufflevector(__s0_214, __s0_214, 3, 2, 1, 0); \
42279 float16x4_t __rev1_214; __rev1_214 = __builtin_shufflevector(__s1_214, __s1_214, 3, 2, 1, 0); \
42280 float16x8_t __rev2_214; __rev2_214 = __builtin_shufflevector(__s2_214, __s2_214, 7, 6, 5, 4, 3, 2, 1, 0); \
42281float16x8_t __reint_214 = __rev2_214; \
42282uint32x2_t __reint1_214 = (uint32x2_t) {__noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_214, __p3_214), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_214, __p3_214)}; \
42283 __ret_214 = __noswap_vcmla_rot180_f16(__rev0_214, __rev1_214, *(float16x4_t *) &__reint1_214); \
42284 __ret_214 = __builtin_shufflevector(__ret_214, __ret_214, 3, 2, 1, 0); \
42285 __ret_214; \
42286})
42287#endif
42288
42289#ifdef __LITTLE_ENDIAN__
42290#define vcmlaq_rot180_laneq_f16(__p0_215, __p1_215, __p2_215, __p3_215) __extension__ ({ \
42291 float16x8_t __ret_215; \
42292 float16x8_t __s0_215 = __p0_215; \
42293 float16x8_t __s1_215 = __p1_215; \
42294 float16x8_t __s2_215 = __p2_215; \
42295float16x8_t __reint_215 = __s2_215; \
42296uint32x4_t __reint1_215 = (uint32x4_t) {vgetq_lane_u32(*(uint32x4_t *) &__reint_215, __p3_215), vgetq_lane_u32(*(uint32x4_t *) &__reint_215, __p3_215), vgetq_lane_u32(*(uint32x4_t *) &__reint_215, __p3_215), vgetq_lane_u32(*(uint32x4_t *) &__reint_215, __p3_215)}; \
42297 __ret_215 = vcmlaq_rot180_f16(__s0_215, __s1_215, *(float16x8_t *) &__reint1_215); \
42298 __ret_215; \
42299})
42300#else
42301#define vcmlaq_rot180_laneq_f16(__p0_216, __p1_216, __p2_216, __p3_216) __extension__ ({ \
42302 float16x8_t __ret_216; \
42303 float16x8_t __s0_216 = __p0_216; \
42304 float16x8_t __s1_216 = __p1_216; \
42305 float16x8_t __s2_216 = __p2_216; \
42306 float16x8_t __rev0_216; __rev0_216 = __builtin_shufflevector(__s0_216, __s0_216, 7, 6, 5, 4, 3, 2, 1, 0); \
42307 float16x8_t __rev1_216; __rev1_216 = __builtin_shufflevector(__s1_216, __s1_216, 7, 6, 5, 4, 3, 2, 1, 0); \
42308 float16x8_t __rev2_216; __rev2_216 = __builtin_shufflevector(__s2_216, __s2_216, 7, 6, 5, 4, 3, 2, 1, 0); \
42309float16x8_t __reint_216 = __rev2_216; \
42310uint32x4_t __reint1_216 = (uint32x4_t) {__noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_216, __p3_216), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_216, __p3_216), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_216, __p3_216), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_216, __p3_216)}; \
42311 __ret_216 = __noswap_vcmlaq_rot180_f16(__rev0_216, __rev1_216, *(float16x8_t *) &__reint1_216); \
42312 __ret_216 = __builtin_shufflevector(__ret_216, __ret_216, 7, 6, 5, 4, 3, 2, 1, 0); \
42313 __ret_216; \
42314})
42315#endif
42316
42317#ifdef __LITTLE_ENDIAN__
42318__ai float16x8_t vcmlaq_rot270_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
42319 float16x8_t __ret;
42320 __ret = (float16x8_t) __builtin_neon_vcmlaq_rot270_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 40);
43138__ai uint64x2_t vcgezq_f64(float64x2_t __p0) {
43139 uint64x2_t __ret;
43140 __ret = (uint64x2_t) __builtin_neon_vcgezq_v((int8x16_t)__p0, 51);
4232143141 return __ret;
4232243142}
4232343143#else
42324__ai float16x8_t vcmlaq_rot270_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
42325 float16x8_t __ret;
42326 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
42327 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
42328 float16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
42329 __ret = (float16x8_t) __builtin_neon_vcmlaq_rot270_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 40);
42330 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
42331 return __ret;
42332}
42333__ai float16x8_t __noswap_vcmlaq_rot270_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
42334 float16x8_t __ret;
42335 __ret = (float16x8_t) __builtin_neon_vcmlaq_rot270_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 40);
43144__ai uint64x2_t vcgezq_f64(float64x2_t __p0) {
43145 uint64x2_t __ret;
43146 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43147 __ret = (uint64x2_t) __builtin_neon_vcgezq_v((int8x16_t)__rev0, 51);
43148 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4233643149 return __ret;
4233743150}
4233843151#endif
4233943152
4234043153#ifdef __LITTLE_ENDIAN__
42341__ai float16x4_t vcmla_rot270_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
42342 float16x4_t __ret;
42343 __ret = (float16x4_t) __builtin_neon_vcmla_rot270_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 8);
43154__ai uint32x4_t vcgezq_f32(float32x4_t __p0) {
43155 uint32x4_t __ret;
43156 __ret = (uint32x4_t) __builtin_neon_vcgezq_v((int8x16_t)__p0, 50);
4234443157 return __ret;
4234543158}
4234643159#else
42347__ai float16x4_t vcmla_rot270_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
42348 float16x4_t __ret;
42349 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
42350 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
42351 float16x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
42352 __ret = (float16x4_t) __builtin_neon_vcmla_rot270_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 8);
43160__ai uint32x4_t vcgezq_f32(float32x4_t __p0) {
43161 uint32x4_t __ret;
43162 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
43163 __ret = (uint32x4_t) __builtin_neon_vcgezq_v((int8x16_t)__rev0, 50);
4235343164 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
4235443165 return __ret;
4235543166}
42356__ai float16x4_t __noswap_vcmla_rot270_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
42357 float16x4_t __ret;
42358 __ret = (float16x4_t) __builtin_neon_vcmla_rot270_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 8);
42359 return __ret;
42360}
42361#endif
42362
42363#ifdef __LITTLE_ENDIAN__
42364#define vcmla_rot270_lane_f16(__p0_217, __p1_217, __p2_217, __p3_217) __extension__ ({ \
42365 float16x4_t __ret_217; \
42366 float16x4_t __s0_217 = __p0_217; \
42367 float16x4_t __s1_217 = __p1_217; \
42368 float16x4_t __s2_217 = __p2_217; \
42369float16x4_t __reint_217 = __s2_217; \
42370uint32x2_t __reint1_217 = (uint32x2_t) {vget_lane_u32(*(uint32x2_t *) &__reint_217, __p3_217), vget_lane_u32(*(uint32x2_t *) &__reint_217, __p3_217)}; \
42371 __ret_217 = vcmla_rot270_f16(__s0_217, __s1_217, *(float16x4_t *) &__reint1_217); \
42372 __ret_217; \
42373})
42374#else
42375#define vcmla_rot270_lane_f16(__p0_218, __p1_218, __p2_218, __p3_218) __extension__ ({ \
42376 float16x4_t __ret_218; \
42377 float16x4_t __s0_218 = __p0_218; \
42378 float16x4_t __s1_218 = __p1_218; \
42379 float16x4_t __s2_218 = __p2_218; \
42380 float16x4_t __rev0_218; __rev0_218 = __builtin_shufflevector(__s0_218, __s0_218, 3, 2, 1, 0); \
42381 float16x4_t __rev1_218; __rev1_218 = __builtin_shufflevector(__s1_218, __s1_218, 3, 2, 1, 0); \
42382 float16x4_t __rev2_218; __rev2_218 = __builtin_shufflevector(__s2_218, __s2_218, 3, 2, 1, 0); \
42383float16x4_t __reint_218 = __rev2_218; \
42384uint32x2_t __reint1_218 = (uint32x2_t) {__noswap_vget_lane_u32(*(uint32x2_t *) &__reint_218, __p3_218), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_218, __p3_218)}; \
42385 __ret_218 = __noswap_vcmla_rot270_f16(__rev0_218, __rev1_218, *(float16x4_t *) &__reint1_218); \
42386 __ret_218 = __builtin_shufflevector(__ret_218, __ret_218, 3, 2, 1, 0); \
42387 __ret_218; \
42388})
42389#endif
42390
42391#ifdef __LITTLE_ENDIAN__
42392#define vcmlaq_rot270_lane_f16(__p0_219, __p1_219, __p2_219, __p3_219) __extension__ ({ \
42393 float16x8_t __ret_219; \
42394 float16x8_t __s0_219 = __p0_219; \
42395 float16x8_t __s1_219 = __p1_219; \
42396 float16x4_t __s2_219 = __p2_219; \
42397float16x4_t __reint_219 = __s2_219; \
42398uint32x4_t __reint1_219 = (uint32x4_t) {vget_lane_u32(*(uint32x2_t *) &__reint_219, __p3_219), vget_lane_u32(*(uint32x2_t *) &__reint_219, __p3_219), vget_lane_u32(*(uint32x2_t *) &__reint_219, __p3_219), vget_lane_u32(*(uint32x2_t *) &__reint_219, __p3_219)}; \
42399 __ret_219 = vcmlaq_rot270_f16(__s0_219, __s1_219, *(float16x8_t *) &__reint1_219); \
42400 __ret_219; \
42401})
42402#else
42403#define vcmlaq_rot270_lane_f16(__p0_220, __p1_220, __p2_220, __p3_220) __extension__ ({ \
42404 float16x8_t __ret_220; \
42405 float16x8_t __s0_220 = __p0_220; \
42406 float16x8_t __s1_220 = __p1_220; \
42407 float16x4_t __s2_220 = __p2_220; \
42408 float16x8_t __rev0_220; __rev0_220 = __builtin_shufflevector(__s0_220, __s0_220, 7, 6, 5, 4, 3, 2, 1, 0); \
42409 float16x8_t __rev1_220; __rev1_220 = __builtin_shufflevector(__s1_220, __s1_220, 7, 6, 5, 4, 3, 2, 1, 0); \
42410 float16x4_t __rev2_220; __rev2_220 = __builtin_shufflevector(__s2_220, __s2_220, 3, 2, 1, 0); \
42411float16x4_t __reint_220 = __rev2_220; \
42412uint32x4_t __reint1_220 = (uint32x4_t) {__noswap_vget_lane_u32(*(uint32x2_t *) &__reint_220, __p3_220), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_220, __p3_220), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_220, __p3_220), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_220, __p3_220)}; \
42413 __ret_220 = __noswap_vcmlaq_rot270_f16(__rev0_220, __rev1_220, *(float16x8_t *) &__reint1_220); \
42414 __ret_220 = __builtin_shufflevector(__ret_220, __ret_220, 7, 6, 5, 4, 3, 2, 1, 0); \
42415 __ret_220; \
42416})
42417#endif
42418
42419#ifdef __LITTLE_ENDIAN__
42420#define vcmla_rot270_laneq_f16(__p0_221, __p1_221, __p2_221, __p3_221) __extension__ ({ \
42421 float16x4_t __ret_221; \
42422 float16x4_t __s0_221 = __p0_221; \
42423 float16x4_t __s1_221 = __p1_221; \
42424 float16x8_t __s2_221 = __p2_221; \
42425float16x8_t __reint_221 = __s2_221; \
42426uint32x2_t __reint1_221 = (uint32x2_t) {vgetq_lane_u32(*(uint32x4_t *) &__reint_221, __p3_221), vgetq_lane_u32(*(uint32x4_t *) &__reint_221, __p3_221)}; \
42427 __ret_221 = vcmla_rot270_f16(__s0_221, __s1_221, *(float16x4_t *) &__reint1_221); \
42428 __ret_221; \
42429})
42430#else
42431#define vcmla_rot270_laneq_f16(__p0_222, __p1_222, __p2_222, __p3_222) __extension__ ({ \
42432 float16x4_t __ret_222; \
42433 float16x4_t __s0_222 = __p0_222; \
42434 float16x4_t __s1_222 = __p1_222; \
42435 float16x8_t __s2_222 = __p2_222; \
42436 float16x4_t __rev0_222; __rev0_222 = __builtin_shufflevector(__s0_222, __s0_222, 3, 2, 1, 0); \
42437 float16x4_t __rev1_222; __rev1_222 = __builtin_shufflevector(__s1_222, __s1_222, 3, 2, 1, 0); \
42438 float16x8_t __rev2_222; __rev2_222 = __builtin_shufflevector(__s2_222, __s2_222, 7, 6, 5, 4, 3, 2, 1, 0); \
42439float16x8_t __reint_222 = __rev2_222; \
42440uint32x2_t __reint1_222 = (uint32x2_t) {__noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_222, __p3_222), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_222, __p3_222)}; \
42441 __ret_222 = __noswap_vcmla_rot270_f16(__rev0_222, __rev1_222, *(float16x4_t *) &__reint1_222); \
42442 __ret_222 = __builtin_shufflevector(__ret_222, __ret_222, 3, 2, 1, 0); \
42443 __ret_222; \
42444})
42445#endif
42446
42447#ifdef __LITTLE_ENDIAN__
42448#define vcmlaq_rot270_laneq_f16(__p0_223, __p1_223, __p2_223, __p3_223) __extension__ ({ \
42449 float16x8_t __ret_223; \
42450 float16x8_t __s0_223 = __p0_223; \
42451 float16x8_t __s1_223 = __p1_223; \
42452 float16x8_t __s2_223 = __p2_223; \
42453float16x8_t __reint_223 = __s2_223; \
42454uint32x4_t __reint1_223 = (uint32x4_t) {vgetq_lane_u32(*(uint32x4_t *) &__reint_223, __p3_223), vgetq_lane_u32(*(uint32x4_t *) &__reint_223, __p3_223), vgetq_lane_u32(*(uint32x4_t *) &__reint_223, __p3_223), vgetq_lane_u32(*(uint32x4_t *) &__reint_223, __p3_223)}; \
42455 __ret_223 = vcmlaq_rot270_f16(__s0_223, __s1_223, *(float16x8_t *) &__reint1_223); \
42456 __ret_223; \
42457})
42458#else
42459#define vcmlaq_rot270_laneq_f16(__p0_224, __p1_224, __p2_224, __p3_224) __extension__ ({ \
42460 float16x8_t __ret_224; \
42461 float16x8_t __s0_224 = __p0_224; \
42462 float16x8_t __s1_224 = __p1_224; \
42463 float16x8_t __s2_224 = __p2_224; \
42464 float16x8_t __rev0_224; __rev0_224 = __builtin_shufflevector(__s0_224, __s0_224, 7, 6, 5, 4, 3, 2, 1, 0); \
42465 float16x8_t __rev1_224; __rev1_224 = __builtin_shufflevector(__s1_224, __s1_224, 7, 6, 5, 4, 3, 2, 1, 0); \
42466 float16x8_t __rev2_224; __rev2_224 = __builtin_shufflevector(__s2_224, __s2_224, 7, 6, 5, 4, 3, 2, 1, 0); \
42467float16x8_t __reint_224 = __rev2_224; \
42468uint32x4_t __reint1_224 = (uint32x4_t) {__noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_224, __p3_224), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_224, __p3_224), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_224, __p3_224), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_224, __p3_224)}; \
42469 __ret_224 = __noswap_vcmlaq_rot270_f16(__rev0_224, __rev1_224, *(float16x8_t *) &__reint1_224); \
42470 __ret_224 = __builtin_shufflevector(__ret_224, __ret_224, 7, 6, 5, 4, 3, 2, 1, 0); \
42471 __ret_224; \
42472})
4247343167#endif
4247443168
4247543169#ifdef __LITTLE_ENDIAN__
42476__ai float16x8_t vcmlaq_rot90_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
42477 float16x8_t __ret;
42478 __ret = (float16x8_t) __builtin_neon_vcmlaq_rot90_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 40);
43170__ai uint32x4_t vcgezq_s32(int32x4_t __p0) {
43171 uint32x4_t __ret;
43172 __ret = (uint32x4_t) __builtin_neon_vcgezq_v((int8x16_t)__p0, 50);
4247943173 return __ret;
4248043174}
4248143175#else
42482__ai float16x8_t vcmlaq_rot90_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
42483 float16x8_t __ret;
42484 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
42485 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
42486 float16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
42487 __ret = (float16x8_t) __builtin_neon_vcmlaq_rot90_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 40);
42488 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
42489 return __ret;
42490}
42491__ai float16x8_t __noswap_vcmlaq_rot90_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
42492 float16x8_t __ret;
42493 __ret = (float16x8_t) __builtin_neon_vcmlaq_rot90_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 40);
43176__ai uint32x4_t vcgezq_s32(int32x4_t __p0) {
43177 uint32x4_t __ret;
43178 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
43179 __ret = (uint32x4_t) __builtin_neon_vcgezq_v((int8x16_t)__rev0, 50);
43180 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
4249443181 return __ret;
4249543182}
4249643183#endif
4249743184
4249843185#ifdef __LITTLE_ENDIAN__
42499__ai float16x4_t vcmla_rot90_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
42500 float16x4_t __ret;
42501 __ret = (float16x4_t) __builtin_neon_vcmla_rot90_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 8);
43186__ai uint64x2_t vcgezq_s64(int64x2_t __p0) {
43187 uint64x2_t __ret;
43188 __ret = (uint64x2_t) __builtin_neon_vcgezq_v((int8x16_t)__p0, 51);
4250243189 return __ret;
4250343190}
4250443191#else
42505__ai float16x4_t vcmla_rot90_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
42506 float16x4_t __ret;
42507 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
42508 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
42509 float16x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
42510 __ret = (float16x4_t) __builtin_neon_vcmla_rot90_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 8);
42511 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
42512 return __ret;
42513}
42514__ai float16x4_t __noswap_vcmla_rot90_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
42515 float16x4_t __ret;
42516 __ret = (float16x4_t) __builtin_neon_vcmla_rot90_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 8);
43192__ai uint64x2_t vcgezq_s64(int64x2_t __p0) {
43193 uint64x2_t __ret;
43194 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43195 __ret = (uint64x2_t) __builtin_neon_vcgezq_v((int8x16_t)__rev0, 51);
43196 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4251743197 return __ret;
4251843198}
4251943199#endif
4252043200
4252143201#ifdef __LITTLE_ENDIAN__
42522#define vcmla_rot90_lane_f16(__p0_225, __p1_225, __p2_225, __p3_225) __extension__ ({ \
42523 float16x4_t __ret_225; \
42524 float16x4_t __s0_225 = __p0_225; \
42525 float16x4_t __s1_225 = __p1_225; \
42526 float16x4_t __s2_225 = __p2_225; \
42527float16x4_t __reint_225 = __s2_225; \
42528uint32x2_t __reint1_225 = (uint32x2_t) {vget_lane_u32(*(uint32x2_t *) &__reint_225, __p3_225), vget_lane_u32(*(uint32x2_t *) &__reint_225, __p3_225)}; \
42529 __ret_225 = vcmla_rot90_f16(__s0_225, __s1_225, *(float16x4_t *) &__reint1_225); \
42530 __ret_225; \
42531})
42532#else
42533#define vcmla_rot90_lane_f16(__p0_226, __p1_226, __p2_226, __p3_226) __extension__ ({ \
42534 float16x4_t __ret_226; \
42535 float16x4_t __s0_226 = __p0_226; \
42536 float16x4_t __s1_226 = __p1_226; \
42537 float16x4_t __s2_226 = __p2_226; \
42538 float16x4_t __rev0_226; __rev0_226 = __builtin_shufflevector(__s0_226, __s0_226, 3, 2, 1, 0); \
42539 float16x4_t __rev1_226; __rev1_226 = __builtin_shufflevector(__s1_226, __s1_226, 3, 2, 1, 0); \
42540 float16x4_t __rev2_226; __rev2_226 = __builtin_shufflevector(__s2_226, __s2_226, 3, 2, 1, 0); \
42541float16x4_t __reint_226 = __rev2_226; \
42542uint32x2_t __reint1_226 = (uint32x2_t) {__noswap_vget_lane_u32(*(uint32x2_t *) &__reint_226, __p3_226), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_226, __p3_226)}; \
42543 __ret_226 = __noswap_vcmla_rot90_f16(__rev0_226, __rev1_226, *(float16x4_t *) &__reint1_226); \
42544 __ret_226 = __builtin_shufflevector(__ret_226, __ret_226, 3, 2, 1, 0); \
42545 __ret_226; \
42546})
42547#endif
42548
42549#ifdef __LITTLE_ENDIAN__
42550#define vcmlaq_rot90_lane_f16(__p0_227, __p1_227, __p2_227, __p3_227) __extension__ ({ \
42551 float16x8_t __ret_227; \
42552 float16x8_t __s0_227 = __p0_227; \
42553 float16x8_t __s1_227 = __p1_227; \
42554 float16x4_t __s2_227 = __p2_227; \
42555float16x4_t __reint_227 = __s2_227; \
42556uint32x4_t __reint1_227 = (uint32x4_t) {vget_lane_u32(*(uint32x2_t *) &__reint_227, __p3_227), vget_lane_u32(*(uint32x2_t *) &__reint_227, __p3_227), vget_lane_u32(*(uint32x2_t *) &__reint_227, __p3_227), vget_lane_u32(*(uint32x2_t *) &__reint_227, __p3_227)}; \
42557 __ret_227 = vcmlaq_rot90_f16(__s0_227, __s1_227, *(float16x8_t *) &__reint1_227); \
42558 __ret_227; \
42559})
42560#else
42561#define vcmlaq_rot90_lane_f16(__p0_228, __p1_228, __p2_228, __p3_228) __extension__ ({ \
42562 float16x8_t __ret_228; \
42563 float16x8_t __s0_228 = __p0_228; \
42564 float16x8_t __s1_228 = __p1_228; \
42565 float16x4_t __s2_228 = __p2_228; \
42566 float16x8_t __rev0_228; __rev0_228 = __builtin_shufflevector(__s0_228, __s0_228, 7, 6, 5, 4, 3, 2, 1, 0); \
42567 float16x8_t __rev1_228; __rev1_228 = __builtin_shufflevector(__s1_228, __s1_228, 7, 6, 5, 4, 3, 2, 1, 0); \
42568 float16x4_t __rev2_228; __rev2_228 = __builtin_shufflevector(__s2_228, __s2_228, 3, 2, 1, 0); \
42569float16x4_t __reint_228 = __rev2_228; \
42570uint32x4_t __reint1_228 = (uint32x4_t) {__noswap_vget_lane_u32(*(uint32x2_t *) &__reint_228, __p3_228), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_228, __p3_228), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_228, __p3_228), __noswap_vget_lane_u32(*(uint32x2_t *) &__reint_228, __p3_228)}; \
42571 __ret_228 = __noswap_vcmlaq_rot90_f16(__rev0_228, __rev1_228, *(float16x8_t *) &__reint1_228); \
42572 __ret_228 = __builtin_shufflevector(__ret_228, __ret_228, 7, 6, 5, 4, 3, 2, 1, 0); \
42573 __ret_228; \
42574})
42575#endif
42576
42577#ifdef __LITTLE_ENDIAN__
42578#define vcmla_rot90_laneq_f16(__p0_229, __p1_229, __p2_229, __p3_229) __extension__ ({ \
42579 float16x4_t __ret_229; \
42580 float16x4_t __s0_229 = __p0_229; \
42581 float16x4_t __s1_229 = __p1_229; \
42582 float16x8_t __s2_229 = __p2_229; \
42583float16x8_t __reint_229 = __s2_229; \
42584uint32x2_t __reint1_229 = (uint32x2_t) {vgetq_lane_u32(*(uint32x4_t *) &__reint_229, __p3_229), vgetq_lane_u32(*(uint32x4_t *) &__reint_229, __p3_229)}; \
42585 __ret_229 = vcmla_rot90_f16(__s0_229, __s1_229, *(float16x4_t *) &__reint1_229); \
42586 __ret_229; \
42587})
42588#else
42589#define vcmla_rot90_laneq_f16(__p0_230, __p1_230, __p2_230, __p3_230) __extension__ ({ \
42590 float16x4_t __ret_230; \
42591 float16x4_t __s0_230 = __p0_230; \
42592 float16x4_t __s1_230 = __p1_230; \
42593 float16x8_t __s2_230 = __p2_230; \
42594 float16x4_t __rev0_230; __rev0_230 = __builtin_shufflevector(__s0_230, __s0_230, 3, 2, 1, 0); \
42595 float16x4_t __rev1_230; __rev1_230 = __builtin_shufflevector(__s1_230, __s1_230, 3, 2, 1, 0); \
42596 float16x8_t __rev2_230; __rev2_230 = __builtin_shufflevector(__s2_230, __s2_230, 7, 6, 5, 4, 3, 2, 1, 0); \
42597float16x8_t __reint_230 = __rev2_230; \
42598uint32x2_t __reint1_230 = (uint32x2_t) {__noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_230, __p3_230), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_230, __p3_230)}; \
42599 __ret_230 = __noswap_vcmla_rot90_f16(__rev0_230, __rev1_230, *(float16x4_t *) &__reint1_230); \
42600 __ret_230 = __builtin_shufflevector(__ret_230, __ret_230, 3, 2, 1, 0); \
42601 __ret_230; \
42602})
42603#endif
42604
42605#ifdef __LITTLE_ENDIAN__
42606#define vcmlaq_rot90_laneq_f16(__p0_231, __p1_231, __p2_231, __p3_231) __extension__ ({ \
42607 float16x8_t __ret_231; \
42608 float16x8_t __s0_231 = __p0_231; \
42609 float16x8_t __s1_231 = __p1_231; \
42610 float16x8_t __s2_231 = __p2_231; \
42611float16x8_t __reint_231 = __s2_231; \
42612uint32x4_t __reint1_231 = (uint32x4_t) {vgetq_lane_u32(*(uint32x4_t *) &__reint_231, __p3_231), vgetq_lane_u32(*(uint32x4_t *) &__reint_231, __p3_231), vgetq_lane_u32(*(uint32x4_t *) &__reint_231, __p3_231), vgetq_lane_u32(*(uint32x4_t *) &__reint_231, __p3_231)}; \
42613 __ret_231 = vcmlaq_rot90_f16(__s0_231, __s1_231, *(float16x8_t *) &__reint1_231); \
42614 __ret_231; \
42615})
43202__ai uint16x8_t vcgezq_s16(int16x8_t __p0) {
43203 uint16x8_t __ret;
43204 __ret = (uint16x8_t) __builtin_neon_vcgezq_v((int8x16_t)__p0, 49);
43205 return __ret;
43206}
4261643207#else
42617#define vcmlaq_rot90_laneq_f16(__p0_232, __p1_232, __p2_232, __p3_232) __extension__ ({ \
42618 float16x8_t __ret_232; \
42619 float16x8_t __s0_232 = __p0_232; \
42620 float16x8_t __s1_232 = __p1_232; \
42621 float16x8_t __s2_232 = __p2_232; \
42622 float16x8_t __rev0_232; __rev0_232 = __builtin_shufflevector(__s0_232, __s0_232, 7, 6, 5, 4, 3, 2, 1, 0); \
42623 float16x8_t __rev1_232; __rev1_232 = __builtin_shufflevector(__s1_232, __s1_232, 7, 6, 5, 4, 3, 2, 1, 0); \
42624 float16x8_t __rev2_232; __rev2_232 = __builtin_shufflevector(__s2_232, __s2_232, 7, 6, 5, 4, 3, 2, 1, 0); \
42625float16x8_t __reint_232 = __rev2_232; \
42626uint32x4_t __reint1_232 = (uint32x4_t) {__noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_232, __p3_232), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_232, __p3_232), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_232, __p3_232), __noswap_vgetq_lane_u32(*(uint32x4_t *) &__reint_232, __p3_232)}; \
42627 __ret_232 = __noswap_vcmlaq_rot90_f16(__rev0_232, __rev1_232, *(float16x8_t *) &__reint1_232); \
42628 __ret_232 = __builtin_shufflevector(__ret_232, __ret_232, 7, 6, 5, 4, 3, 2, 1, 0); \
42629 __ret_232; \
42630})
43208__ai uint16x8_t vcgezq_s16(int16x8_t __p0) {
43209 uint16x8_t __ret;
43210 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
43211 __ret = (uint16x8_t) __builtin_neon_vcgezq_v((int8x16_t)__rev0, 49);
43212 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
43213 return __ret;
43214}
4263143215#endif
4263243216
42633#endif
42634#if defined(__ARM_FEATURE_COMPLEX) && defined(__aarch64__)
4263543217#ifdef __LITTLE_ENDIAN__
42636__ai float64x2_t vcaddq_rot270_f64(float64x2_t __p0, float64x2_t __p1) {
42637 float64x2_t __ret;
42638 __ret = (float64x2_t) __builtin_neon_vcaddq_rot270_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
43218__ai uint8x8_t vcgez_s8(int8x8_t __p0) {
43219 uint8x8_t __ret;
43220 __ret = (uint8x8_t) __builtin_neon_vcgez_v((int8x8_t)__p0, 16);
4263943221 return __ret;
4264043222}
4264143223#else
42642__ai float64x2_t vcaddq_rot270_f64(float64x2_t __p0, float64x2_t __p1) {
42643 float64x2_t __ret;
42644 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
42645 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
42646 __ret = (float64x2_t) __builtin_neon_vcaddq_rot270_v((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
42647 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
43224__ai uint8x8_t vcgez_s8(int8x8_t __p0) {
43225 uint8x8_t __ret;
43226 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
43227 __ret = (uint8x8_t) __builtin_neon_vcgez_v((int8x8_t)__rev0, 16);
43228 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
4264843229 return __ret;
4264943230}
4265043231#endif
4265143232
43233__ai uint64x1_t vcgez_f64(float64x1_t __p0) {
43234 uint64x1_t __ret;
43235 __ret = (uint64x1_t) __builtin_neon_vcgez_v((int8x8_t)__p0, 19);
43236 return __ret;
43237}
4265243238#ifdef __LITTLE_ENDIAN__
42653__ai float64x2_t vcaddq_rot90_f64(float64x2_t __p0, float64x2_t __p1) {
42654 float64x2_t __ret;
42655 __ret = (float64x2_t) __builtin_neon_vcaddq_rot90_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
43239__ai uint32x2_t vcgez_f32(float32x2_t __p0) {
43240 uint32x2_t __ret;
43241 __ret = (uint32x2_t) __builtin_neon_vcgez_v((int8x8_t)__p0, 18);
4265643242 return __ret;
4265743243}
4265843244#else
42659__ai float64x2_t vcaddq_rot90_f64(float64x2_t __p0, float64x2_t __p1) {
42660 float64x2_t __ret;
42661 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
42662 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
42663 __ret = (float64x2_t) __builtin_neon_vcaddq_rot90_v((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
43245__ai uint32x2_t vcgez_f32(float32x2_t __p0) {
43246 uint32x2_t __ret;
43247 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43248 __ret = (uint32x2_t) __builtin_neon_vcgez_v((int8x8_t)__rev0, 18);
4266443249 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4266543250 return __ret;
4266643251}
4266743252#endif
4266843253
4266943254#ifdef __LITTLE_ENDIAN__
42670__ai float64x2_t vcmlaq_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
42671 float64x2_t __ret;
42672 __ret = (float64x2_t) __builtin_neon_vcmlaq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 42);
43255__ai uint32x2_t vcgez_s32(int32x2_t __p0) {
43256 uint32x2_t __ret;
43257 __ret = (uint32x2_t) __builtin_neon_vcgez_v((int8x8_t)__p0, 18);
4267343258 return __ret;
4267443259}
4267543260#else
42676__ai float64x2_t vcmlaq_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
42677 float64x2_t __ret;
42678 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
42679 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
42680 float64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
42681 __ret = (float64x2_t) __builtin_neon_vcmlaq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 42);
43261__ai uint32x2_t vcgez_s32(int32x2_t __p0) {
43262 uint32x2_t __ret;
43263 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43264 __ret = (uint32x2_t) __builtin_neon_vcgez_v((int8x8_t)__rev0, 18);
4268243265 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4268343266 return __ret;
4268443267}
42685__ai float64x2_t __noswap_vcmlaq_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
42686 float64x2_t __ret;
42687 __ret = (float64x2_t) __builtin_neon_vcmlaq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 42);
42688 return __ret;
42689}
4269043268#endif
4269143269
42692__ai float64x1_t vcmla_f64(float64x1_t __p0, float64x1_t __p1, float64x1_t __p2) {
42693 float64x1_t __ret;
42694 __ret = (float64x1_t) __builtin_neon_vcmla_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 10);
43270__ai uint64x1_t vcgez_s64(int64x1_t __p0) {
43271 uint64x1_t __ret;
43272 __ret = (uint64x1_t) __builtin_neon_vcgez_v((int8x8_t)__p0, 19);
4269543273 return __ret;
4269643274}
42697#define vcmla_lane_f64(__p0_233, __p1_233, __p2_233, __p3_233) __extension__ ({ \
42698 float64x1_t __ret_233; \
42699 float64x1_t __s0_233 = __p0_233; \
42700 float64x1_t __s1_233 = __p1_233; \
42701 float64x1_t __s2_233 = __p2_233; \
42702float64x1_t __reint_233 = __s2_233; \
42703uint64x2_t __reint1_233 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_233, __p3_233), vgetq_lane_u64(*(uint64x2_t *) &__reint_233, __p3_233)}; \
42704 __ret_233 = vcmla_f64(__s0_233, __s1_233, *(float64x1_t *) &__reint1_233); \
42705 __ret_233; \
42706})
42707#ifdef __LITTLE_ENDIAN__
42708#define vcmlaq_lane_f64(__p0_234, __p1_234, __p2_234, __p3_234) __extension__ ({ \
42709 float64x2_t __ret_234; \
42710 float64x2_t __s0_234 = __p0_234; \
42711 float64x2_t __s1_234 = __p1_234; \
42712 float64x1_t __s2_234 = __p2_234; \
42713float64x1_t __reint_234 = __s2_234; \
42714uint64x2_t __reint1_234 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_234, __p3_234), vgetq_lane_u64(*(uint64x2_t *) &__reint_234, __p3_234)}; \
42715 __ret_234 = vcmlaq_f64(__s0_234, __s1_234, *(float64x2_t *) &__reint1_234); \
42716 __ret_234; \
42717})
42718#else
42719#define vcmlaq_lane_f64(__p0_235, __p1_235, __p2_235, __p3_235) __extension__ ({ \
42720 float64x2_t __ret_235; \
42721 float64x2_t __s0_235 = __p0_235; \
42722 float64x2_t __s1_235 = __p1_235; \
42723 float64x1_t __s2_235 = __p2_235; \
42724 float64x2_t __rev0_235; __rev0_235 = __builtin_shufflevector(__s0_235, __s0_235, 1, 0); \
42725 float64x2_t __rev1_235; __rev1_235 = __builtin_shufflevector(__s1_235, __s1_235, 1, 0); \
42726float64x1_t __reint_235 = __s2_235; \
42727uint64x2_t __reint1_235 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_235, __p3_235), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_235, __p3_235)}; \
42728 __ret_235 = __noswap_vcmlaq_f64(__rev0_235, __rev1_235, *(float64x2_t *) &__reint1_235); \
42729 __ret_235 = __builtin_shufflevector(__ret_235, __ret_235, 1, 0); \
42730 __ret_235; \
42731})
42732#endif
42733
4273443275#ifdef __LITTLE_ENDIAN__
42735#define vcmla_laneq_f64(__p0_236, __p1_236, __p2_236, __p3_236) __extension__ ({ \
42736 float64x1_t __ret_236; \
42737 float64x1_t __s0_236 = __p0_236; \
42738 float64x1_t __s1_236 = __p1_236; \
42739 float64x2_t __s2_236 = __p2_236; \
42740float64x2_t __reint_236 = __s2_236; \
42741uint64x2_t __reint1_236 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_236, __p3_236), vgetq_lane_u64(*(uint64x2_t *) &__reint_236, __p3_236)}; \
42742 __ret_236 = vcmla_f64(__s0_236, __s1_236, *(float64x1_t *) &__reint1_236); \
42743 __ret_236; \
42744})
43276__ai uint16x4_t vcgez_s16(int16x4_t __p0) {
43277 uint16x4_t __ret;
43278 __ret = (uint16x4_t) __builtin_neon_vcgez_v((int8x8_t)__p0, 17);
43279 return __ret;
43280}
4274543281#else
42746#define vcmla_laneq_f64(__p0_237, __p1_237, __p2_237, __p3_237) __extension__ ({ \
42747 float64x1_t __ret_237; \
42748 float64x1_t __s0_237 = __p0_237; \
42749 float64x1_t __s1_237 = __p1_237; \
42750 float64x2_t __s2_237 = __p2_237; \
42751 float64x2_t __rev2_237; __rev2_237 = __builtin_shufflevector(__s2_237, __s2_237, 1, 0); \
42752float64x2_t __reint_237 = __rev2_237; \
42753uint64x2_t __reint1_237 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_237, __p3_237), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_237, __p3_237)}; \
42754 __ret_237 = vcmla_f64(__s0_237, __s1_237, *(float64x1_t *) &__reint1_237); \
42755 __ret_237; \
42756})
43282__ai uint16x4_t vcgez_s16(int16x4_t __p0) {
43283 uint16x4_t __ret;
43284 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
43285 __ret = (uint16x4_t) __builtin_neon_vcgez_v((int8x8_t)__rev0, 17);
43286 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
43287 return __ret;
43288}
4275743289#endif
4275843290
43291__ai uint64_t vcgezd_s64(int64_t __p0) {
43292 uint64_t __ret;
43293 __ret = (uint64_t) __builtin_neon_vcgezd_s64(__p0);
43294 return __ret;
43295}
43296__ai uint64_t vcgezd_f64(float64_t __p0) {
43297 uint64_t __ret;
43298 __ret = (uint64_t) __builtin_neon_vcgezd_f64(__p0);
43299 return __ret;
43300}
43301__ai uint32_t vcgezs_f32(float32_t __p0) {
43302 uint32_t __ret;
43303 __ret = (uint32_t) __builtin_neon_vcgezs_f32(__p0);
43304 return __ret;
43305}
4275943306#ifdef __LITTLE_ENDIAN__
42760#define vcmlaq_laneq_f64(__p0_238, __p1_238, __p2_238, __p3_238) __extension__ ({ \
42761 float64x2_t __ret_238; \
42762 float64x2_t __s0_238 = __p0_238; \
42763 float64x2_t __s1_238 = __p1_238; \
42764 float64x2_t __s2_238 = __p2_238; \
42765float64x2_t __reint_238 = __s2_238; \
42766uint64x2_t __reint1_238 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_238, __p3_238), vgetq_lane_u64(*(uint64x2_t *) &__reint_238, __p3_238)}; \
42767 __ret_238 = vcmlaq_f64(__s0_238, __s1_238, *(float64x2_t *) &__reint1_238); \
42768 __ret_238; \
42769})
43307__ai uint64x2_t vcgtq_u64(uint64x2_t __p0, uint64x2_t __p1) {
43308 uint64x2_t __ret;
43309 __ret = (uint64x2_t)(__p0 > __p1);
43310 return __ret;
43311}
4277043312#else
42771#define vcmlaq_laneq_f64(__p0_239, __p1_239, __p2_239, __p3_239) __extension__ ({ \
42772 float64x2_t __ret_239; \
42773 float64x2_t __s0_239 = __p0_239; \
42774 float64x2_t __s1_239 = __p1_239; \
42775 float64x2_t __s2_239 = __p2_239; \
42776 float64x2_t __rev0_239; __rev0_239 = __builtin_shufflevector(__s0_239, __s0_239, 1, 0); \
42777 float64x2_t __rev1_239; __rev1_239 = __builtin_shufflevector(__s1_239, __s1_239, 1, 0); \
42778 float64x2_t __rev2_239; __rev2_239 = __builtin_shufflevector(__s2_239, __s2_239, 1, 0); \
42779float64x2_t __reint_239 = __rev2_239; \
42780uint64x2_t __reint1_239 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_239, __p3_239), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_239, __p3_239)}; \
42781 __ret_239 = __noswap_vcmlaq_f64(__rev0_239, __rev1_239, *(float64x2_t *) &__reint1_239); \
42782 __ret_239 = __builtin_shufflevector(__ret_239, __ret_239, 1, 0); \
42783 __ret_239; \
42784})
43313__ai uint64x2_t vcgtq_u64(uint64x2_t __p0, uint64x2_t __p1) {
43314 uint64x2_t __ret;
43315 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43316 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
43317 __ret = (uint64x2_t)(__rev0 > __rev1);
43318 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
43319 return __ret;
43320}
4278543321#endif
4278643322
4278743323#ifdef __LITTLE_ENDIAN__
42788__ai float64x2_t vcmlaq_rot180_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
42789 float64x2_t __ret;
42790 __ret = (float64x2_t) __builtin_neon_vcmlaq_rot180_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 42);
43324__ai uint64x2_t vcgtq_f64(float64x2_t __p0, float64x2_t __p1) {
43325 uint64x2_t __ret;
43326 __ret = (uint64x2_t)(__p0 > __p1);
4279143327 return __ret;
4279243328}
4279343329#else
42794__ai float64x2_t vcmlaq_rot180_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
42795 float64x2_t __ret;
43330__ai uint64x2_t vcgtq_f64(float64x2_t __p0, float64x2_t __p1) {
43331 uint64x2_t __ret;
4279643332 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
4279743333 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
42798 float64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
42799 __ret = (float64x2_t) __builtin_neon_vcmlaq_rot180_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 42);
43334 __ret = (uint64x2_t)(__rev0 > __rev1);
4280043335 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4280143336 return __ret;
4280243337}
42803__ai float64x2_t __noswap_vcmlaq_rot180_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
42804 float64x2_t __ret;
42805 __ret = (float64x2_t) __builtin_neon_vcmlaq_rot180_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 42);
42806 return __ret;
42807}
4280843338#endif
4280943339
42810__ai float64x1_t vcmla_rot180_f64(float64x1_t __p0, float64x1_t __p1, float64x1_t __p2) {
42811 float64x1_t __ret;
42812 __ret = (float64x1_t) __builtin_neon_vcmla_rot180_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 10);
43340#ifdef __LITTLE_ENDIAN__
43341__ai uint64x2_t vcgtq_s64(int64x2_t __p0, int64x2_t __p1) {
43342 uint64x2_t __ret;
43343 __ret = (uint64x2_t)(__p0 > __p1);
4281343344 return __ret;
4281443345}
42815#define vcmla_rot180_lane_f64(__p0_240, __p1_240, __p2_240, __p3_240) __extension__ ({ \
42816 float64x1_t __ret_240; \
42817 float64x1_t __s0_240 = __p0_240; \
42818 float64x1_t __s1_240 = __p1_240; \
42819 float64x1_t __s2_240 = __p2_240; \
42820float64x1_t __reint_240 = __s2_240; \
42821uint64x2_t __reint1_240 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_240, __p3_240), vgetq_lane_u64(*(uint64x2_t *) &__reint_240, __p3_240)}; \
42822 __ret_240 = vcmla_rot180_f64(__s0_240, __s1_240, *(float64x1_t *) &__reint1_240); \
42823 __ret_240; \
42824})
42825#ifdef __LITTLE_ENDIAN__
42826#define vcmlaq_rot180_lane_f64(__p0_241, __p1_241, __p2_241, __p3_241) __extension__ ({ \
42827 float64x2_t __ret_241; \
42828 float64x2_t __s0_241 = __p0_241; \
42829 float64x2_t __s1_241 = __p1_241; \
42830 float64x1_t __s2_241 = __p2_241; \
42831float64x1_t __reint_241 = __s2_241; \
42832uint64x2_t __reint1_241 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_241, __p3_241), vgetq_lane_u64(*(uint64x2_t *) &__reint_241, __p3_241)}; \
42833 __ret_241 = vcmlaq_rot180_f64(__s0_241, __s1_241, *(float64x2_t *) &__reint1_241); \
42834 __ret_241; \
42835})
42836#else
42837#define vcmlaq_rot180_lane_f64(__p0_242, __p1_242, __p2_242, __p3_242) __extension__ ({ \
42838 float64x2_t __ret_242; \
42839 float64x2_t __s0_242 = __p0_242; \
42840 float64x2_t __s1_242 = __p1_242; \
42841 float64x1_t __s2_242 = __p2_242; \
42842 float64x2_t __rev0_242; __rev0_242 = __builtin_shufflevector(__s0_242, __s0_242, 1, 0); \
42843 float64x2_t __rev1_242; __rev1_242 = __builtin_shufflevector(__s1_242, __s1_242, 1, 0); \
42844float64x1_t __reint_242 = __s2_242; \
42845uint64x2_t __reint1_242 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_242, __p3_242), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_242, __p3_242)}; \
42846 __ret_242 = __noswap_vcmlaq_rot180_f64(__rev0_242, __rev1_242, *(float64x2_t *) &__reint1_242); \
42847 __ret_242 = __builtin_shufflevector(__ret_242, __ret_242, 1, 0); \
42848 __ret_242; \
42849})
42850#endif
42851
42852#ifdef __LITTLE_ENDIAN__
42853#define vcmla_rot180_laneq_f64(__p0_243, __p1_243, __p2_243, __p3_243) __extension__ ({ \
42854 float64x1_t __ret_243; \
42855 float64x1_t __s0_243 = __p0_243; \
42856 float64x1_t __s1_243 = __p1_243; \
42857 float64x2_t __s2_243 = __p2_243; \
42858float64x2_t __reint_243 = __s2_243; \
42859uint64x2_t __reint1_243 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_243, __p3_243), vgetq_lane_u64(*(uint64x2_t *) &__reint_243, __p3_243)}; \
42860 __ret_243 = vcmla_rot180_f64(__s0_243, __s1_243, *(float64x1_t *) &__reint1_243); \
42861 __ret_243; \
42862})
4286343346#else
42864#define vcmla_rot180_laneq_f64(__p0_244, __p1_244, __p2_244, __p3_244) __extension__ ({ \
42865 float64x1_t __ret_244; \
42866 float64x1_t __s0_244 = __p0_244; \
42867 float64x1_t __s1_244 = __p1_244; \
42868 float64x2_t __s2_244 = __p2_244; \
42869 float64x2_t __rev2_244; __rev2_244 = __builtin_shufflevector(__s2_244, __s2_244, 1, 0); \
42870float64x2_t __reint_244 = __rev2_244; \
42871uint64x2_t __reint1_244 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_244, __p3_244), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_244, __p3_244)}; \
42872 __ret_244 = vcmla_rot180_f64(__s0_244, __s1_244, *(float64x1_t *) &__reint1_244); \
42873 __ret_244; \
42874})
42875#endif
42876
42877#ifdef __LITTLE_ENDIAN__
42878#define vcmlaq_rot180_laneq_f64(__p0_245, __p1_245, __p2_245, __p3_245) __extension__ ({ \
42879 float64x2_t __ret_245; \
42880 float64x2_t __s0_245 = __p0_245; \
42881 float64x2_t __s1_245 = __p1_245; \
42882 float64x2_t __s2_245 = __p2_245; \
42883float64x2_t __reint_245 = __s2_245; \
42884uint64x2_t __reint1_245 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_245, __p3_245), vgetq_lane_u64(*(uint64x2_t *) &__reint_245, __p3_245)}; \
42885 __ret_245 = vcmlaq_rot180_f64(__s0_245, __s1_245, *(float64x2_t *) &__reint1_245); \
42886 __ret_245; \
42887})
42888#else
42889#define vcmlaq_rot180_laneq_f64(__p0_246, __p1_246, __p2_246, __p3_246) __extension__ ({ \
42890 float64x2_t __ret_246; \
42891 float64x2_t __s0_246 = __p0_246; \
42892 float64x2_t __s1_246 = __p1_246; \
42893 float64x2_t __s2_246 = __p2_246; \
42894 float64x2_t __rev0_246; __rev0_246 = __builtin_shufflevector(__s0_246, __s0_246, 1, 0); \
42895 float64x2_t __rev1_246; __rev1_246 = __builtin_shufflevector(__s1_246, __s1_246, 1, 0); \
42896 float64x2_t __rev2_246; __rev2_246 = __builtin_shufflevector(__s2_246, __s2_246, 1, 0); \
42897float64x2_t __reint_246 = __rev2_246; \
42898uint64x2_t __reint1_246 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_246, __p3_246), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_246, __p3_246)}; \
42899 __ret_246 = __noswap_vcmlaq_rot180_f64(__rev0_246, __rev1_246, *(float64x2_t *) &__reint1_246); \
42900 __ret_246 = __builtin_shufflevector(__ret_246, __ret_246, 1, 0); \
42901 __ret_246; \
42902})
43347__ai uint64x2_t vcgtq_s64(int64x2_t __p0, int64x2_t __p1) {
43348 uint64x2_t __ret;
43349 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43350 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
43351 __ret = (uint64x2_t)(__rev0 > __rev1);
43352 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
43353 return __ret;
43354}
4290343355#endif
4290443356
42905#ifdef __LITTLE_ENDIAN__
42906__ai float64x2_t vcmlaq_rot270_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
42907 float64x2_t __ret;
42908 __ret = (float64x2_t) __builtin_neon_vcmlaq_rot270_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 42);
43357__ai uint64x1_t vcgt_u64(uint64x1_t __p0, uint64x1_t __p1) {
43358 uint64x1_t __ret;
43359 __ret = (uint64x1_t)(__p0 > __p1);
4290943360 return __ret;
4291043361}
42911#else
42912__ai float64x2_t vcmlaq_rot270_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
42913 float64x2_t __ret;
42914 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
42915 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
42916 float64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
42917 __ret = (float64x2_t) __builtin_neon_vcmlaq_rot270_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 42);
42918 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
43362__ai uint64x1_t vcgt_f64(float64x1_t __p0, float64x1_t __p1) {
43363 uint64x1_t __ret;
43364 __ret = (uint64x1_t)(__p0 > __p1);
4291943365 return __ret;
4292043366}
42921__ai float64x2_t __noswap_vcmlaq_rot270_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
42922 float64x2_t __ret;
42923 __ret = (float64x2_t) __builtin_neon_vcmlaq_rot270_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 42);
43367__ai uint64x1_t vcgt_s64(int64x1_t __p0, int64x1_t __p1) {
43368 uint64x1_t __ret;
43369 __ret = (uint64x1_t)(__p0 > __p1);
4292443370 return __ret;
4292543371}
42926#endif
42927
42928__ai float64x1_t vcmla_rot270_f64(float64x1_t __p0, float64x1_t __p1, float64x1_t __p2) {
42929 float64x1_t __ret;
42930 __ret = (float64x1_t) __builtin_neon_vcmla_rot270_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 10);
43372__ai uint64_t vcgtd_s64(int64_t __p0, int64_t __p1) {
43373 uint64_t __ret;
43374 __ret = (uint64_t) __builtin_neon_vcgtd_s64(__p0, __p1);
43375 return __ret;
43376}
43377__ai uint64_t vcgtd_u64(uint64_t __p0, uint64_t __p1) {
43378 uint64_t __ret;
43379 __ret = (uint64_t) __builtin_neon_vcgtd_u64(__p0, __p1);
43380 return __ret;
43381}
43382__ai uint64_t vcgtd_f64(float64_t __p0, float64_t __p1) {
43383 uint64_t __ret;
43384 __ret = (uint64_t) __builtin_neon_vcgtd_f64(__p0, __p1);
43385 return __ret;
43386}
43387__ai uint32_t vcgts_f32(float32_t __p0, float32_t __p1) {
43388 uint32_t __ret;
43389 __ret = (uint32_t) __builtin_neon_vcgts_f32(__p0, __p1);
4293143390 return __ret;
4293243391}
42933#define vcmla_rot270_lane_f64(__p0_247, __p1_247, __p2_247, __p3_247) __extension__ ({ \
42934 float64x1_t __ret_247; \
42935 float64x1_t __s0_247 = __p0_247; \
42936 float64x1_t __s1_247 = __p1_247; \
42937 float64x1_t __s2_247 = __p2_247; \
42938float64x1_t __reint_247 = __s2_247; \
42939uint64x2_t __reint1_247 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_247, __p3_247), vgetq_lane_u64(*(uint64x2_t *) &__reint_247, __p3_247)}; \
42940 __ret_247 = vcmla_rot270_f64(__s0_247, __s1_247, *(float64x1_t *) &__reint1_247); \
42941 __ret_247; \
42942})
42943#ifdef __LITTLE_ENDIAN__
42944#define vcmlaq_rot270_lane_f64(__p0_248, __p1_248, __p2_248, __p3_248) __extension__ ({ \
42945 float64x2_t __ret_248; \
42946 float64x2_t __s0_248 = __p0_248; \
42947 float64x2_t __s1_248 = __p1_248; \
42948 float64x1_t __s2_248 = __p2_248; \
42949float64x1_t __reint_248 = __s2_248; \
42950uint64x2_t __reint1_248 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_248, __p3_248), vgetq_lane_u64(*(uint64x2_t *) &__reint_248, __p3_248)}; \
42951 __ret_248 = vcmlaq_rot270_f64(__s0_248, __s1_248, *(float64x2_t *) &__reint1_248); \
42952 __ret_248; \
42953})
42954#else
42955#define vcmlaq_rot270_lane_f64(__p0_249, __p1_249, __p2_249, __p3_249) __extension__ ({ \
42956 float64x2_t __ret_249; \
42957 float64x2_t __s0_249 = __p0_249; \
42958 float64x2_t __s1_249 = __p1_249; \
42959 float64x1_t __s2_249 = __p2_249; \
42960 float64x2_t __rev0_249; __rev0_249 = __builtin_shufflevector(__s0_249, __s0_249, 1, 0); \
42961 float64x2_t __rev1_249; __rev1_249 = __builtin_shufflevector(__s1_249, __s1_249, 1, 0); \
42962float64x1_t __reint_249 = __s2_249; \
42963uint64x2_t __reint1_249 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_249, __p3_249), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_249, __p3_249)}; \
42964 __ret_249 = __noswap_vcmlaq_rot270_f64(__rev0_249, __rev1_249, *(float64x2_t *) &__reint1_249); \
42965 __ret_249 = __builtin_shufflevector(__ret_249, __ret_249, 1, 0); \
42966 __ret_249; \
42967})
42968#endif
42969
42970#ifdef __LITTLE_ENDIAN__
42971#define vcmla_rot270_laneq_f64(__p0_250, __p1_250, __p2_250, __p3_250) __extension__ ({ \
42972 float64x1_t __ret_250; \
42973 float64x1_t __s0_250 = __p0_250; \
42974 float64x1_t __s1_250 = __p1_250; \
42975 float64x2_t __s2_250 = __p2_250; \
42976float64x2_t __reint_250 = __s2_250; \
42977uint64x2_t __reint1_250 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_250, __p3_250), vgetq_lane_u64(*(uint64x2_t *) &__reint_250, __p3_250)}; \
42978 __ret_250 = vcmla_rot270_f64(__s0_250, __s1_250, *(float64x1_t *) &__reint1_250); \
42979 __ret_250; \
42980})
42981#else
42982#define vcmla_rot270_laneq_f64(__p0_251, __p1_251, __p2_251, __p3_251) __extension__ ({ \
42983 float64x1_t __ret_251; \
42984 float64x1_t __s0_251 = __p0_251; \
42985 float64x1_t __s1_251 = __p1_251; \
42986 float64x2_t __s2_251 = __p2_251; \
42987 float64x2_t __rev2_251; __rev2_251 = __builtin_shufflevector(__s2_251, __s2_251, 1, 0); \
42988float64x2_t __reint_251 = __rev2_251; \
42989uint64x2_t __reint1_251 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_251, __p3_251), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_251, __p3_251)}; \
42990 __ret_251 = vcmla_rot270_f64(__s0_251, __s1_251, *(float64x1_t *) &__reint1_251); \
42991 __ret_251; \
42992})
42993#endif
42994
4299543392#ifdef __LITTLE_ENDIAN__
42996#define vcmlaq_rot270_laneq_f64(__p0_252, __p1_252, __p2_252, __p3_252) __extension__ ({ \
42997 float64x2_t __ret_252; \
42998 float64x2_t __s0_252 = __p0_252; \
42999 float64x2_t __s1_252 = __p1_252; \
43000 float64x2_t __s2_252 = __p2_252; \
43001float64x2_t __reint_252 = __s2_252; \
43002uint64x2_t __reint1_252 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_252, __p3_252), vgetq_lane_u64(*(uint64x2_t *) &__reint_252, __p3_252)}; \
43003 __ret_252 = vcmlaq_rot270_f64(__s0_252, __s1_252, *(float64x2_t *) &__reint1_252); \
43004 __ret_252; \
43005})
43393__ai uint8x16_t vcgtzq_s8(int8x16_t __p0) {
43394 uint8x16_t __ret;
43395 __ret = (uint8x16_t) __builtin_neon_vcgtzq_v((int8x16_t)__p0, 48);
43396 return __ret;
43397}
4300643398#else
43007#define vcmlaq_rot270_laneq_f64(__p0_253, __p1_253, __p2_253, __p3_253) __extension__ ({ \
43008 float64x2_t __ret_253; \
43009 float64x2_t __s0_253 = __p0_253; \
43010 float64x2_t __s1_253 = __p1_253; \
43011 float64x2_t __s2_253 = __p2_253; \
43012 float64x2_t __rev0_253; __rev0_253 = __builtin_shufflevector(__s0_253, __s0_253, 1, 0); \
43013 float64x2_t __rev1_253; __rev1_253 = __builtin_shufflevector(__s1_253, __s1_253, 1, 0); \
43014 float64x2_t __rev2_253; __rev2_253 = __builtin_shufflevector(__s2_253, __s2_253, 1, 0); \
43015float64x2_t __reint_253 = __rev2_253; \
43016uint64x2_t __reint1_253 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_253, __p3_253), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_253, __p3_253)}; \
43017 __ret_253 = __noswap_vcmlaq_rot270_f64(__rev0_253, __rev1_253, *(float64x2_t *) &__reint1_253); \
43018 __ret_253 = __builtin_shufflevector(__ret_253, __ret_253, 1, 0); \
43019 __ret_253; \
43020})
43399__ai uint8x16_t vcgtzq_s8(int8x16_t __p0) {
43400 uint8x16_t __ret;
43401 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
43402 __ret = (uint8x16_t) __builtin_neon_vcgtzq_v((int8x16_t)__rev0, 48);
43403 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
43404 return __ret;
43405}
4302143406#endif
4302243407
4302343408#ifdef __LITTLE_ENDIAN__
43024__ai float64x2_t vcmlaq_rot90_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
43025 float64x2_t __ret;
43026 __ret = (float64x2_t) __builtin_neon_vcmlaq_rot90_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 42);
43409__ai uint64x2_t vcgtzq_f64(float64x2_t __p0) {
43410 uint64x2_t __ret;
43411 __ret = (uint64x2_t) __builtin_neon_vcgtzq_v((int8x16_t)__p0, 51);
4302743412 return __ret;
4302843413}
4302943414#else
43030__ai float64x2_t vcmlaq_rot90_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
43031 float64x2_t __ret;
43415__ai uint64x2_t vcgtzq_f64(float64x2_t __p0) {
43416 uint64x2_t __ret;
4303243417 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43033 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
43034 float64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
43035 __ret = (float64x2_t) __builtin_neon_vcmlaq_rot90_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 42);
43418 __ret = (uint64x2_t) __builtin_neon_vcgtzq_v((int8x16_t)__rev0, 51);
4303643419 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4303743420 return __ret;
4303843421}
43039__ai float64x2_t __noswap_vcmlaq_rot90_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
43040 float64x2_t __ret;
43041 __ret = (float64x2_t) __builtin_neon_vcmlaq_rot90_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 42);
43042 return __ret;
43043}
4304443422#endif
4304543423
43046__ai float64x1_t vcmla_rot90_f64(float64x1_t __p0, float64x1_t __p1, float64x1_t __p2) {
43047 float64x1_t __ret;
43048 __ret = (float64x1_t) __builtin_neon_vcmla_rot90_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 10);
43424#ifdef __LITTLE_ENDIAN__
43425__ai uint32x4_t vcgtzq_f32(float32x4_t __p0) {
43426 uint32x4_t __ret;
43427 __ret = (uint32x4_t) __builtin_neon_vcgtzq_v((int8x16_t)__p0, 50);
4304943428 return __ret;
4305043429}
43051#define vcmla_rot90_lane_f64(__p0_254, __p1_254, __p2_254, __p3_254) __extension__ ({ \
43052 float64x1_t __ret_254; \
43053 float64x1_t __s0_254 = __p0_254; \
43054 float64x1_t __s1_254 = __p1_254; \
43055 float64x1_t __s2_254 = __p2_254; \
43056float64x1_t __reint_254 = __s2_254; \
43057uint64x2_t __reint1_254 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_254, __p3_254), vgetq_lane_u64(*(uint64x2_t *) &__reint_254, __p3_254)}; \
43058 __ret_254 = vcmla_rot90_f64(__s0_254, __s1_254, *(float64x1_t *) &__reint1_254); \
43059 __ret_254; \
43060})
43061#ifdef __LITTLE_ENDIAN__
43062#define vcmlaq_rot90_lane_f64(__p0_255, __p1_255, __p2_255, __p3_255) __extension__ ({ \
43063 float64x2_t __ret_255; \
43064 float64x2_t __s0_255 = __p0_255; \
43065 float64x2_t __s1_255 = __p1_255; \
43066 float64x1_t __s2_255 = __p2_255; \
43067float64x1_t __reint_255 = __s2_255; \
43068uint64x2_t __reint1_255 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_255, __p3_255), vgetq_lane_u64(*(uint64x2_t *) &__reint_255, __p3_255)}; \
43069 __ret_255 = vcmlaq_rot90_f64(__s0_255, __s1_255, *(float64x2_t *) &__reint1_255); \
43070 __ret_255; \
43071})
4307243430#else
43073#define vcmlaq_rot90_lane_f64(__p0_256, __p1_256, __p2_256, __p3_256) __extension__ ({ \
43074 float64x2_t __ret_256; \
43075 float64x2_t __s0_256 = __p0_256; \
43076 float64x2_t __s1_256 = __p1_256; \
43077 float64x1_t __s2_256 = __p2_256; \
43078 float64x2_t __rev0_256; __rev0_256 = __builtin_shufflevector(__s0_256, __s0_256, 1, 0); \
43079 float64x2_t __rev1_256; __rev1_256 = __builtin_shufflevector(__s1_256, __s1_256, 1, 0); \
43080float64x1_t __reint_256 = __s2_256; \
43081uint64x2_t __reint1_256 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_256, __p3_256), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_256, __p3_256)}; \
43082 __ret_256 = __noswap_vcmlaq_rot90_f64(__rev0_256, __rev1_256, *(float64x2_t *) &__reint1_256); \
43083 __ret_256 = __builtin_shufflevector(__ret_256, __ret_256, 1, 0); \
43084 __ret_256; \
43085})
43431__ai uint32x4_t vcgtzq_f32(float32x4_t __p0) {
43432 uint32x4_t __ret;
43433 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
43434 __ret = (uint32x4_t) __builtin_neon_vcgtzq_v((int8x16_t)__rev0, 50);
43435 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
43436 return __ret;
43437}
4308643438#endif
4308743439
4308843440#ifdef __LITTLE_ENDIAN__
43089#define vcmla_rot90_laneq_f64(__p0_257, __p1_257, __p2_257, __p3_257) __extension__ ({ \
43090 float64x1_t __ret_257; \
43091 float64x1_t __s0_257 = __p0_257; \
43092 float64x1_t __s1_257 = __p1_257; \
43093 float64x2_t __s2_257 = __p2_257; \
43094float64x2_t __reint_257 = __s2_257; \
43095uint64x2_t __reint1_257 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_257, __p3_257), vgetq_lane_u64(*(uint64x2_t *) &__reint_257, __p3_257)}; \
43096 __ret_257 = vcmla_rot90_f64(__s0_257, __s1_257, *(float64x1_t *) &__reint1_257); \
43097 __ret_257; \
43098})
43441__ai uint32x4_t vcgtzq_s32(int32x4_t __p0) {
43442 uint32x4_t __ret;
43443 __ret = (uint32x4_t) __builtin_neon_vcgtzq_v((int8x16_t)__p0, 50);
43444 return __ret;
43445}
4309943446#else
43100#define vcmla_rot90_laneq_f64(__p0_258, __p1_258, __p2_258, __p3_258) __extension__ ({ \
43101 float64x1_t __ret_258; \
43102 float64x1_t __s0_258 = __p0_258; \
43103 float64x1_t __s1_258 = __p1_258; \
43104 float64x2_t __s2_258 = __p2_258; \
43105 float64x2_t __rev2_258; __rev2_258 = __builtin_shufflevector(__s2_258, __s2_258, 1, 0); \
43106float64x2_t __reint_258 = __rev2_258; \
43107uint64x2_t __reint1_258 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_258, __p3_258), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_258, __p3_258)}; \
43108 __ret_258 = vcmla_rot90_f64(__s0_258, __s1_258, *(float64x1_t *) &__reint1_258); \
43109 __ret_258; \
43110})
43447__ai uint32x4_t vcgtzq_s32(int32x4_t __p0) {
43448 uint32x4_t __ret;
43449 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
43450 __ret = (uint32x4_t) __builtin_neon_vcgtzq_v((int8x16_t)__rev0, 50);
43451 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
43452 return __ret;
43453}
4311143454#endif
4311243455
4311343456#ifdef __LITTLE_ENDIAN__
43114#define vcmlaq_rot90_laneq_f64(__p0_259, __p1_259, __p2_259, __p3_259) __extension__ ({ \
43115 float64x2_t __ret_259; \
43116 float64x2_t __s0_259 = __p0_259; \
43117 float64x2_t __s1_259 = __p1_259; \
43118 float64x2_t __s2_259 = __p2_259; \
43119float64x2_t __reint_259 = __s2_259; \
43120uint64x2_t __reint1_259 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_259, __p3_259), vgetq_lane_u64(*(uint64x2_t *) &__reint_259, __p3_259)}; \
43121 __ret_259 = vcmlaq_rot90_f64(__s0_259, __s1_259, *(float64x2_t *) &__reint1_259); \
43122 __ret_259; \
43123})
43457__ai uint64x2_t vcgtzq_s64(int64x2_t __p0) {
43458 uint64x2_t __ret;
43459 __ret = (uint64x2_t) __builtin_neon_vcgtzq_v((int8x16_t)__p0, 51);
43460 return __ret;
43461}
4312443462#else
43125#define vcmlaq_rot90_laneq_f64(__p0_260, __p1_260, __p2_260, __p3_260) __extension__ ({ \
43126 float64x2_t __ret_260; \
43127 float64x2_t __s0_260 = __p0_260; \
43128 float64x2_t __s1_260 = __p1_260; \
43129 float64x2_t __s2_260 = __p2_260; \
43130 float64x2_t __rev0_260; __rev0_260 = __builtin_shufflevector(__s0_260, __s0_260, 1, 0); \
43131 float64x2_t __rev1_260; __rev1_260 = __builtin_shufflevector(__s1_260, __s1_260, 1, 0); \
43132 float64x2_t __rev2_260; __rev2_260 = __builtin_shufflevector(__s2_260, __s2_260, 1, 0); \
43133float64x2_t __reint_260 = __rev2_260; \
43134uint64x2_t __reint1_260 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_260, __p3_260), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_260, __p3_260)}; \
43135 __ret_260 = __noswap_vcmlaq_rot90_f64(__rev0_260, __rev1_260, *(float64x2_t *) &__reint1_260); \
43136 __ret_260 = __builtin_shufflevector(__ret_260, __ret_260, 1, 0); \
43137 __ret_260; \
43138})
43463__ai uint64x2_t vcgtzq_s64(int64x2_t __p0) {
43464 uint64x2_t __ret;
43465 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43466 __ret = (uint64x2_t) __builtin_neon_vcgtzq_v((int8x16_t)__rev0, 51);
43467 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
43468 return __ret;
43469}
4313943470#endif
4314043471
43141#endif
43142#if defined(__ARM_FEATURE_DOTPROD)
4314343472#ifdef __LITTLE_ENDIAN__
43144__ai uint32x4_t vdotq_u32(uint32x4_t __p0, uint8x16_t __p1, uint8x16_t __p2) {
43145 uint32x4_t __ret;
43146 __ret = (uint32x4_t) __builtin_neon_vdotq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 50);
43473__ai uint16x8_t vcgtzq_s16(int16x8_t __p0) {
43474 uint16x8_t __ret;
43475 __ret = (uint16x8_t) __builtin_neon_vcgtzq_v((int8x16_t)__p0, 49);
4314743476 return __ret;
4314843477}
4314943478#else
43150__ai uint32x4_t vdotq_u32(uint32x4_t __p0, uint8x16_t __p1, uint8x16_t __p2) {
43151 uint32x4_t __ret;
43152 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
43153 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
43154 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
43155 __ret = (uint32x4_t) __builtin_neon_vdotq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 50);
43156 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
43157 return __ret;
43158}
43159__ai uint32x4_t __noswap_vdotq_u32(uint32x4_t __p0, uint8x16_t __p1, uint8x16_t __p2) {
43160 uint32x4_t __ret;
43161 __ret = (uint32x4_t) __builtin_neon_vdotq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 50);
43479__ai uint16x8_t vcgtzq_s16(int16x8_t __p0) {
43480 uint16x8_t __ret;
43481 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
43482 __ret = (uint16x8_t) __builtin_neon_vcgtzq_v((int8x16_t)__rev0, 49);
43483 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
4316243484 return __ret;
4316343485}
4316443486#endif
4316543487
4316643488#ifdef __LITTLE_ENDIAN__
43167__ai int32x4_t vdotq_s32(int32x4_t __p0, int8x16_t __p1, int8x16_t __p2) {
43168 int32x4_t __ret;
43169 __ret = (int32x4_t) __builtin_neon_vdotq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 34);
43489__ai uint8x8_t vcgtz_s8(int8x8_t __p0) {
43490 uint8x8_t __ret;
43491 __ret = (uint8x8_t) __builtin_neon_vcgtz_v((int8x8_t)__p0, 16);
4317043492 return __ret;
4317143493}
4317243494#else
43173__ai int32x4_t vdotq_s32(int32x4_t __p0, int8x16_t __p1, int8x16_t __p2) {
43174 int32x4_t __ret;
43175 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
43176 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
43177 int8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
43178 __ret = (int32x4_t) __builtin_neon_vdotq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 34);
43179 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
43180 return __ret;
43181}
43182__ai int32x4_t __noswap_vdotq_s32(int32x4_t __p0, int8x16_t __p1, int8x16_t __p2) {
43183 int32x4_t __ret;
43184 __ret = (int32x4_t) __builtin_neon_vdotq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 34);
43495__ai uint8x8_t vcgtz_s8(int8x8_t __p0) {
43496 uint8x8_t __ret;
43497 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
43498 __ret = (uint8x8_t) __builtin_neon_vcgtz_v((int8x8_t)__rev0, 16);
43499 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
4318543500 return __ret;
4318643501}
4318743502#endif
4318843503
43504__ai uint64x1_t vcgtz_f64(float64x1_t __p0) {
43505 uint64x1_t __ret;
43506 __ret = (uint64x1_t) __builtin_neon_vcgtz_v((int8x8_t)__p0, 19);
43507 return __ret;
43508}
4318943509#ifdef __LITTLE_ENDIAN__
43190__ai uint32x2_t vdot_u32(uint32x2_t __p0, uint8x8_t __p1, uint8x8_t __p2) {
43510__ai uint32x2_t vcgtz_f32(float32x2_t __p0) {
4319143511 uint32x2_t __ret;
43192 __ret = (uint32x2_t) __builtin_neon_vdot_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 18);
43512 __ret = (uint32x2_t) __builtin_neon_vcgtz_v((int8x8_t)__p0, 18);
4319343513 return __ret;
4319443514}
4319543515#else
43196__ai uint32x2_t vdot_u32(uint32x2_t __p0, uint8x8_t __p1, uint8x8_t __p2) {
43516__ai uint32x2_t vcgtz_f32(float32x2_t __p0) {
4319743517 uint32x2_t __ret;
43198 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43199 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
43200 uint8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
43201 __ret = (uint32x2_t) __builtin_neon_vdot_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 18);
43518 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43519 __ret = (uint32x2_t) __builtin_neon_vcgtz_v((int8x8_t)__rev0, 18);
4320243520 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4320343521 return __ret;
4320443522}
43205__ai uint32x2_t __noswap_vdot_u32(uint32x2_t __p0, uint8x8_t __p1, uint8x8_t __p2) {
43206 uint32x2_t __ret;
43207 __ret = (uint32x2_t) __builtin_neon_vdot_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 18);
43208 return __ret;
43209}
4321043523#endif
4321143524
4321243525#ifdef __LITTLE_ENDIAN__
43213__ai int32x2_t vdot_s32(int32x2_t __p0, int8x8_t __p1, int8x8_t __p2) {
43214 int32x2_t __ret;
43215 __ret = (int32x2_t) __builtin_neon_vdot_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 2);
43526__ai uint32x2_t vcgtz_s32(int32x2_t __p0) {
43527 uint32x2_t __ret;
43528 __ret = (uint32x2_t) __builtin_neon_vcgtz_v((int8x8_t)__p0, 18);
4321643529 return __ret;
4321743530}
4321843531#else
43219__ai int32x2_t vdot_s32(int32x2_t __p0, int8x8_t __p1, int8x8_t __p2) {
43220 int32x2_t __ret;
43532__ai uint32x2_t vcgtz_s32(int32x2_t __p0) {
43533 uint32x2_t __ret;
4322143534 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43222 int8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
43223 int8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
43224 __ret = (int32x2_t) __builtin_neon_vdot_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 2);
43535 __ret = (uint32x2_t) __builtin_neon_vcgtz_v((int8x8_t)__rev0, 18);
4322543536 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4322643537 return __ret;
4322743538}
43228__ai int32x2_t __noswap_vdot_s32(int32x2_t __p0, int8x8_t __p1, int8x8_t __p2) {
43229 int32x2_t __ret;
43230 __ret = (int32x2_t) __builtin_neon_vdot_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 2);
43231 return __ret;
43232}
43233#endif
43234
43235#ifdef __LITTLE_ENDIAN__
43236#define vdotq_lane_u32(__p0_261, __p1_261, __p2_261, __p3_261) __extension__ ({ \
43237 uint32x4_t __ret_261; \
43238 uint32x4_t __s0_261 = __p0_261; \
43239 uint8x16_t __s1_261 = __p1_261; \
43240 uint8x8_t __s2_261 = __p2_261; \
43241uint8x8_t __reint_261 = __s2_261; \
43242uint32x4_t __reint1_261 = splatq_lane_u32(*(uint32x2_t *) &__reint_261, __p3_261); \
43243 __ret_261 = vdotq_u32(__s0_261, __s1_261, *(uint8x16_t *) &__reint1_261); \
43244 __ret_261; \
43245})
43246#else
43247#define vdotq_lane_u32(__p0_262, __p1_262, __p2_262, __p3_262) __extension__ ({ \
43248 uint32x4_t __ret_262; \
43249 uint32x4_t __s0_262 = __p0_262; \
43250 uint8x16_t __s1_262 = __p1_262; \
43251 uint8x8_t __s2_262 = __p2_262; \
43252 uint32x4_t __rev0_262; __rev0_262 = __builtin_shufflevector(__s0_262, __s0_262, 3, 2, 1, 0); \
43253 uint8x16_t __rev1_262; __rev1_262 = __builtin_shufflevector(__s1_262, __s1_262, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
43254 uint8x8_t __rev2_262; __rev2_262 = __builtin_shufflevector(__s2_262, __s2_262, 7, 6, 5, 4, 3, 2, 1, 0); \
43255uint8x8_t __reint_262 = __rev2_262; \
43256uint32x4_t __reint1_262 = __noswap_splatq_lane_u32(*(uint32x2_t *) &__reint_262, __p3_262); \
43257 __ret_262 = __noswap_vdotq_u32(__rev0_262, __rev1_262, *(uint8x16_t *) &__reint1_262); \
43258 __ret_262 = __builtin_shufflevector(__ret_262, __ret_262, 3, 2, 1, 0); \
43259 __ret_262; \
43260})
43261#endif
43262
43263#ifdef __LITTLE_ENDIAN__
43264#define vdotq_lane_s32(__p0_263, __p1_263, __p2_263, __p3_263) __extension__ ({ \
43265 int32x4_t __ret_263; \
43266 int32x4_t __s0_263 = __p0_263; \
43267 int8x16_t __s1_263 = __p1_263; \
43268 int8x8_t __s2_263 = __p2_263; \
43269int8x8_t __reint_263 = __s2_263; \
43270int32x4_t __reint1_263 = splatq_lane_s32(*(int32x2_t *) &__reint_263, __p3_263); \
43271 __ret_263 = vdotq_s32(__s0_263, __s1_263, *(int8x16_t *) &__reint1_263); \
43272 __ret_263; \
43273})
43274#else
43275#define vdotq_lane_s32(__p0_264, __p1_264, __p2_264, __p3_264) __extension__ ({ \
43276 int32x4_t __ret_264; \
43277 int32x4_t __s0_264 = __p0_264; \
43278 int8x16_t __s1_264 = __p1_264; \
43279 int8x8_t __s2_264 = __p2_264; \
43280 int32x4_t __rev0_264; __rev0_264 = __builtin_shufflevector(__s0_264, __s0_264, 3, 2, 1, 0); \
43281 int8x16_t __rev1_264; __rev1_264 = __builtin_shufflevector(__s1_264, __s1_264, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
43282 int8x8_t __rev2_264; __rev2_264 = __builtin_shufflevector(__s2_264, __s2_264, 7, 6, 5, 4, 3, 2, 1, 0); \
43283int8x8_t __reint_264 = __rev2_264; \
43284int32x4_t __reint1_264 = __noswap_splatq_lane_s32(*(int32x2_t *) &__reint_264, __p3_264); \
43285 __ret_264 = __noswap_vdotq_s32(__rev0_264, __rev1_264, *(int8x16_t *) &__reint1_264); \
43286 __ret_264 = __builtin_shufflevector(__ret_264, __ret_264, 3, 2, 1, 0); \
43287 __ret_264; \
43288})
4328943539#endif
4329043540
43541__ai uint64x1_t vcgtz_s64(int64x1_t __p0) {
43542 uint64x1_t __ret;
43543 __ret = (uint64x1_t) __builtin_neon_vcgtz_v((int8x8_t)__p0, 19);
43544 return __ret;
43545}
4329143546#ifdef __LITTLE_ENDIAN__
43292#define vdot_lane_u32(__p0_265, __p1_265, __p2_265, __p3_265) __extension__ ({ \
43293 uint32x2_t __ret_265; \
43294 uint32x2_t __s0_265 = __p0_265; \
43295 uint8x8_t __s1_265 = __p1_265; \
43296 uint8x8_t __s2_265 = __p2_265; \
43297uint8x8_t __reint_265 = __s2_265; \
43298uint32x2_t __reint1_265 = splat_lane_u32(*(uint32x2_t *) &__reint_265, __p3_265); \
43299 __ret_265 = vdot_u32(__s0_265, __s1_265, *(uint8x8_t *) &__reint1_265); \
43300 __ret_265; \
43301})
43547__ai uint16x4_t vcgtz_s16(int16x4_t __p0) {
43548 uint16x4_t __ret;
43549 __ret = (uint16x4_t) __builtin_neon_vcgtz_v((int8x8_t)__p0, 17);
43550 return __ret;
43551}
4330243552#else
43303#define vdot_lane_u32(__p0_266, __p1_266, __p2_266, __p3_266) __extension__ ({ \
43304 uint32x2_t __ret_266; \
43305 uint32x2_t __s0_266 = __p0_266; \
43306 uint8x8_t __s1_266 = __p1_266; \
43307 uint8x8_t __s2_266 = __p2_266; \
43308 uint32x2_t __rev0_266; __rev0_266 = __builtin_shufflevector(__s0_266, __s0_266, 1, 0); \
43309 uint8x8_t __rev1_266; __rev1_266 = __builtin_shufflevector(__s1_266, __s1_266, 7, 6, 5, 4, 3, 2, 1, 0); \
43310 uint8x8_t __rev2_266; __rev2_266 = __builtin_shufflevector(__s2_266, __s2_266, 7, 6, 5, 4, 3, 2, 1, 0); \
43311uint8x8_t __reint_266 = __rev2_266; \
43312uint32x2_t __reint1_266 = __noswap_splat_lane_u32(*(uint32x2_t *) &__reint_266, __p3_266); \
43313 __ret_266 = __noswap_vdot_u32(__rev0_266, __rev1_266, *(uint8x8_t *) &__reint1_266); \
43314 __ret_266 = __builtin_shufflevector(__ret_266, __ret_266, 1, 0); \
43315 __ret_266; \
43316})
43553__ai uint16x4_t vcgtz_s16(int16x4_t __p0) {
43554 uint16x4_t __ret;
43555 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
43556 __ret = (uint16x4_t) __builtin_neon_vcgtz_v((int8x8_t)__rev0, 17);
43557 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
43558 return __ret;
43559}
4331743560#endif
4331843561
43562__ai uint64_t vcgtzd_s64(int64_t __p0) {
43563 uint64_t __ret;
43564 __ret = (uint64_t) __builtin_neon_vcgtzd_s64(__p0);
43565 return __ret;
43566}
43567__ai uint64_t vcgtzd_f64(float64_t __p0) {
43568 uint64_t __ret;
43569 __ret = (uint64_t) __builtin_neon_vcgtzd_f64(__p0);
43570 return __ret;
43571}
43572__ai uint32_t vcgtzs_f32(float32_t __p0) {
43573 uint32_t __ret;
43574 __ret = (uint32_t) __builtin_neon_vcgtzs_f32(__p0);
43575 return __ret;
43576}
4331943577#ifdef __LITTLE_ENDIAN__
43320#define vdot_lane_s32(__p0_267, __p1_267, __p2_267, __p3_267) __extension__ ({ \
43321 int32x2_t __ret_267; \
43322 int32x2_t __s0_267 = __p0_267; \
43323 int8x8_t __s1_267 = __p1_267; \
43324 int8x8_t __s2_267 = __p2_267; \
43325int8x8_t __reint_267 = __s2_267; \
43326int32x2_t __reint1_267 = splat_lane_s32(*(int32x2_t *) &__reint_267, __p3_267); \
43327 __ret_267 = vdot_s32(__s0_267, __s1_267, *(int8x8_t *) &__reint1_267); \
43328 __ret_267; \
43329})
43578__ai uint64x2_t vcleq_u64(uint64x2_t __p0, uint64x2_t __p1) {
43579 uint64x2_t __ret;
43580 __ret = (uint64x2_t)(__p0 <= __p1);
43581 return __ret;
43582}
4333043583#else
43331#define vdot_lane_s32(__p0_268, __p1_268, __p2_268, __p3_268) __extension__ ({ \
43332 int32x2_t __ret_268; \
43333 int32x2_t __s0_268 = __p0_268; \
43334 int8x8_t __s1_268 = __p1_268; \
43335 int8x8_t __s2_268 = __p2_268; \
43336 int32x2_t __rev0_268; __rev0_268 = __builtin_shufflevector(__s0_268, __s0_268, 1, 0); \
43337 int8x8_t __rev1_268; __rev1_268 = __builtin_shufflevector(__s1_268, __s1_268, 7, 6, 5, 4, 3, 2, 1, 0); \
43338 int8x8_t __rev2_268; __rev2_268 = __builtin_shufflevector(__s2_268, __s2_268, 7, 6, 5, 4, 3, 2, 1, 0); \
43339int8x8_t __reint_268 = __rev2_268; \
43340int32x2_t __reint1_268 = __noswap_splat_lane_s32(*(int32x2_t *) &__reint_268, __p3_268); \
43341 __ret_268 = __noswap_vdot_s32(__rev0_268, __rev1_268, *(int8x8_t *) &__reint1_268); \
43342 __ret_268 = __builtin_shufflevector(__ret_268, __ret_268, 1, 0); \
43343 __ret_268; \
43344})
43584__ai uint64x2_t vcleq_u64(uint64x2_t __p0, uint64x2_t __p1) {
43585 uint64x2_t __ret;
43586 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43587 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
43588 __ret = (uint64x2_t)(__rev0 <= __rev1);
43589 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
43590 return __ret;
43591}
4334543592#endif
4334643593
43347#endif
43348#if defined(__ARM_FEATURE_DOTPROD) && defined(__aarch64__)
4334943594#ifdef __LITTLE_ENDIAN__
43350#define vdotq_laneq_u32(__p0_269, __p1_269, __p2_269, __p3_269) __extension__ ({ \
43351 uint32x4_t __ret_269; \
43352 uint32x4_t __s0_269 = __p0_269; \
43353 uint8x16_t __s1_269 = __p1_269; \
43354 uint8x16_t __s2_269 = __p2_269; \
43355uint8x16_t __reint_269 = __s2_269; \
43356uint32x4_t __reint1_269 = splatq_laneq_u32(*(uint32x4_t *) &__reint_269, __p3_269); \
43357 __ret_269 = vdotq_u32(__s0_269, __s1_269, *(uint8x16_t *) &__reint1_269); \
43358 __ret_269; \
43359})
43595__ai uint64x2_t vcleq_f64(float64x2_t __p0, float64x2_t __p1) {
43596 uint64x2_t __ret;
43597 __ret = (uint64x2_t)(__p0 <= __p1);
43598 return __ret;
43599}
4336043600#else
43361#define vdotq_laneq_u32(__p0_270, __p1_270, __p2_270, __p3_270) __extension__ ({ \
43362 uint32x4_t __ret_270; \
43363 uint32x4_t __s0_270 = __p0_270; \
43364 uint8x16_t __s1_270 = __p1_270; \
43365 uint8x16_t __s2_270 = __p2_270; \
43366 uint32x4_t __rev0_270; __rev0_270 = __builtin_shufflevector(__s0_270, __s0_270, 3, 2, 1, 0); \
43367 uint8x16_t __rev1_270; __rev1_270 = __builtin_shufflevector(__s1_270, __s1_270, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
43368 uint8x16_t __rev2_270; __rev2_270 = __builtin_shufflevector(__s2_270, __s2_270, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
43369uint8x16_t __reint_270 = __rev2_270; \
43370uint32x4_t __reint1_270 = __noswap_splatq_laneq_u32(*(uint32x4_t *) &__reint_270, __p3_270); \
43371 __ret_270 = __noswap_vdotq_u32(__rev0_270, __rev1_270, *(uint8x16_t *) &__reint1_270); \
43372 __ret_270 = __builtin_shufflevector(__ret_270, __ret_270, 3, 2, 1, 0); \
43373 __ret_270; \
43374})
43601__ai uint64x2_t vcleq_f64(float64x2_t __p0, float64x2_t __p1) {
43602 uint64x2_t __ret;
43603 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43604 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
43605 __ret = (uint64x2_t)(__rev0 <= __rev1);
43606 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
43607 return __ret;
43608}
4337543609#endif
4337643610
4337743611#ifdef __LITTLE_ENDIAN__
43378#define vdotq_laneq_s32(__p0_271, __p1_271, __p2_271, __p3_271) __extension__ ({ \
43379 int32x4_t __ret_271; \
43380 int32x4_t __s0_271 = __p0_271; \
43381 int8x16_t __s1_271 = __p1_271; \
43382 int8x16_t __s2_271 = __p2_271; \
43383int8x16_t __reint_271 = __s2_271; \
43384int32x4_t __reint1_271 = splatq_laneq_s32(*(int32x4_t *) &__reint_271, __p3_271); \
43385 __ret_271 = vdotq_s32(__s0_271, __s1_271, *(int8x16_t *) &__reint1_271); \
43386 __ret_271; \
43387})
43612__ai uint64x2_t vcleq_s64(int64x2_t __p0, int64x2_t __p1) {
43613 uint64x2_t __ret;
43614 __ret = (uint64x2_t)(__p0 <= __p1);
43615 return __ret;
43616}
4338843617#else
43389#define vdotq_laneq_s32(__p0_272, __p1_272, __p2_272, __p3_272) __extension__ ({ \
43390 int32x4_t __ret_272; \
43391 int32x4_t __s0_272 = __p0_272; \
43392 int8x16_t __s1_272 = __p1_272; \
43393 int8x16_t __s2_272 = __p2_272; \
43394 int32x4_t __rev0_272; __rev0_272 = __builtin_shufflevector(__s0_272, __s0_272, 3, 2, 1, 0); \
43395 int8x16_t __rev1_272; __rev1_272 = __builtin_shufflevector(__s1_272, __s1_272, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
43396 int8x16_t __rev2_272; __rev2_272 = __builtin_shufflevector(__s2_272, __s2_272, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
43397int8x16_t __reint_272 = __rev2_272; \
43398int32x4_t __reint1_272 = __noswap_splatq_laneq_s32(*(int32x4_t *) &__reint_272, __p3_272); \
43399 __ret_272 = __noswap_vdotq_s32(__rev0_272, __rev1_272, *(int8x16_t *) &__reint1_272); \
43400 __ret_272 = __builtin_shufflevector(__ret_272, __ret_272, 3, 2, 1, 0); \
43401 __ret_272; \
43402})
43618__ai uint64x2_t vcleq_s64(int64x2_t __p0, int64x2_t __p1) {
43619 uint64x2_t __ret;
43620 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43621 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
43622 __ret = (uint64x2_t)(__rev0 <= __rev1);
43623 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
43624 return __ret;
43625}
4340343626#endif
4340443627
43628__ai uint64x1_t vcle_u64(uint64x1_t __p0, uint64x1_t __p1) {
43629 uint64x1_t __ret;
43630 __ret = (uint64x1_t)(__p0 <= __p1);
43631 return __ret;
43632}
43633__ai uint64x1_t vcle_f64(float64x1_t __p0, float64x1_t __p1) {
43634 uint64x1_t __ret;
43635 __ret = (uint64x1_t)(__p0 <= __p1);
43636 return __ret;
43637}
43638__ai uint64x1_t vcle_s64(int64x1_t __p0, int64x1_t __p1) {
43639 uint64x1_t __ret;
43640 __ret = (uint64x1_t)(__p0 <= __p1);
43641 return __ret;
43642}
43643__ai uint64_t vcled_u64(uint64_t __p0, uint64_t __p1) {
43644 uint64_t __ret;
43645 __ret = (uint64_t) __builtin_neon_vcled_u64(__p0, __p1);
43646 return __ret;
43647}
43648__ai uint64_t vcled_s64(int64_t __p0, int64_t __p1) {
43649 uint64_t __ret;
43650 __ret = (uint64_t) __builtin_neon_vcled_s64(__p0, __p1);
43651 return __ret;
43652}
43653__ai uint64_t vcled_f64(float64_t __p0, float64_t __p1) {
43654 uint64_t __ret;
43655 __ret = (uint64_t) __builtin_neon_vcled_f64(__p0, __p1);
43656 return __ret;
43657}
43658__ai uint32_t vcles_f32(float32_t __p0, float32_t __p1) {
43659 uint32_t __ret;
43660 __ret = (uint32_t) __builtin_neon_vcles_f32(__p0, __p1);
43661 return __ret;
43662}
4340543663#ifdef __LITTLE_ENDIAN__
43406#define vdot_laneq_u32(__p0_273, __p1_273, __p2_273, __p3_273) __extension__ ({ \
43407 uint32x2_t __ret_273; \
43408 uint32x2_t __s0_273 = __p0_273; \
43409 uint8x8_t __s1_273 = __p1_273; \
43410 uint8x16_t __s2_273 = __p2_273; \
43411uint8x16_t __reint_273 = __s2_273; \
43412uint32x2_t __reint1_273 = splat_laneq_u32(*(uint32x4_t *) &__reint_273, __p3_273); \
43413 __ret_273 = vdot_u32(__s0_273, __s1_273, *(uint8x8_t *) &__reint1_273); \
43414 __ret_273; \
43415})
43664__ai uint8x16_t vclezq_s8(int8x16_t __p0) {
43665 uint8x16_t __ret;
43666 __ret = (uint8x16_t) __builtin_neon_vclezq_v((int8x16_t)__p0, 48);
43667 return __ret;
43668}
4341643669#else
43417#define vdot_laneq_u32(__p0_274, __p1_274, __p2_274, __p3_274) __extension__ ({ \
43418 uint32x2_t __ret_274; \
43419 uint32x2_t __s0_274 = __p0_274; \
43420 uint8x8_t __s1_274 = __p1_274; \
43421 uint8x16_t __s2_274 = __p2_274; \
43422 uint32x2_t __rev0_274; __rev0_274 = __builtin_shufflevector(__s0_274, __s0_274, 1, 0); \
43423 uint8x8_t __rev1_274; __rev1_274 = __builtin_shufflevector(__s1_274, __s1_274, 7, 6, 5, 4, 3, 2, 1, 0); \
43424 uint8x16_t __rev2_274; __rev2_274 = __builtin_shufflevector(__s2_274, __s2_274, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
43425uint8x16_t __reint_274 = __rev2_274; \
43426uint32x2_t __reint1_274 = __noswap_splat_laneq_u32(*(uint32x4_t *) &__reint_274, __p3_274); \
43427 __ret_274 = __noswap_vdot_u32(__rev0_274, __rev1_274, *(uint8x8_t *) &__reint1_274); \
43428 __ret_274 = __builtin_shufflevector(__ret_274, __ret_274, 1, 0); \
43429 __ret_274; \
43430})
43670__ai uint8x16_t vclezq_s8(int8x16_t __p0) {
43671 uint8x16_t __ret;
43672 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
43673 __ret = (uint8x16_t) __builtin_neon_vclezq_v((int8x16_t)__rev0, 48);
43674 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
43675 return __ret;
43676}
4343143677#endif
4343243678
4343343679#ifdef __LITTLE_ENDIAN__
43434#define vdot_laneq_s32(__p0_275, __p1_275, __p2_275, __p3_275) __extension__ ({ \
43435 int32x2_t __ret_275; \
43436 int32x2_t __s0_275 = __p0_275; \
43437 int8x8_t __s1_275 = __p1_275; \
43438 int8x16_t __s2_275 = __p2_275; \
43439int8x16_t __reint_275 = __s2_275; \
43440int32x2_t __reint1_275 = splat_laneq_s32(*(int32x4_t *) &__reint_275, __p3_275); \
43441 __ret_275 = vdot_s32(__s0_275, __s1_275, *(int8x8_t *) &__reint1_275); \
43442 __ret_275; \
43443})
43680__ai uint64x2_t vclezq_f64(float64x2_t __p0) {
43681 uint64x2_t __ret;
43682 __ret = (uint64x2_t) __builtin_neon_vclezq_v((int8x16_t)__p0, 51);
43683 return __ret;
43684}
4344443685#else
43445#define vdot_laneq_s32(__p0_276, __p1_276, __p2_276, __p3_276) __extension__ ({ \
43446 int32x2_t __ret_276; \
43447 int32x2_t __s0_276 = __p0_276; \
43448 int8x8_t __s1_276 = __p1_276; \
43449 int8x16_t __s2_276 = __p2_276; \
43450 int32x2_t __rev0_276; __rev0_276 = __builtin_shufflevector(__s0_276, __s0_276, 1, 0); \
43451 int8x8_t __rev1_276; __rev1_276 = __builtin_shufflevector(__s1_276, __s1_276, 7, 6, 5, 4, 3, 2, 1, 0); \
43452 int8x16_t __rev2_276; __rev2_276 = __builtin_shufflevector(__s2_276, __s2_276, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
43453int8x16_t __reint_276 = __rev2_276; \
43454int32x2_t __reint1_276 = __noswap_splat_laneq_s32(*(int32x4_t *) &__reint_276, __p3_276); \
43455 __ret_276 = __noswap_vdot_s32(__rev0_276, __rev1_276, *(int8x8_t *) &__reint1_276); \
43456 __ret_276 = __builtin_shufflevector(__ret_276, __ret_276, 1, 0); \
43457 __ret_276; \
43458})
43686__ai uint64x2_t vclezq_f64(float64x2_t __p0) {
43687 uint64x2_t __ret;
43688 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43689 __ret = (uint64x2_t) __builtin_neon_vclezq_v((int8x16_t)__rev0, 51);
43690 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
43691 return __ret;
43692}
4345943693#endif
4346043694
43461#endif
43462#if defined(__ARM_FEATURE_FMA)
4346343695#ifdef __LITTLE_ENDIAN__
43464__ai float32x4_t vfmaq_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
43465 float32x4_t __ret;
43466 __ret = (float32x4_t) __builtin_neon_vfmaq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
43696__ai uint32x4_t vclezq_f32(float32x4_t __p0) {
43697 uint32x4_t __ret;
43698 __ret = (uint32x4_t) __builtin_neon_vclezq_v((int8x16_t)__p0, 50);
4346743699 return __ret;
4346843700}
4346943701#else
43470__ai float32x4_t vfmaq_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
43471 float32x4_t __ret;
43702__ai uint32x4_t vclezq_f32(float32x4_t __p0) {
43703 uint32x4_t __ret;
4347243704 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
43473 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
43474 float32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
43475 __ret = (float32x4_t) __builtin_neon_vfmaq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 41);
43705 __ret = (uint32x4_t) __builtin_neon_vclezq_v((int8x16_t)__rev0, 50);
4347643706 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
4347743707 return __ret;
4347843708}
43479__ai float32x4_t __noswap_vfmaq_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
43480 float32x4_t __ret;
43481 __ret = (float32x4_t) __builtin_neon_vfmaq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
43709#endif
43710
43711#ifdef __LITTLE_ENDIAN__
43712__ai uint32x4_t vclezq_s32(int32x4_t __p0) {
43713 uint32x4_t __ret;
43714 __ret = (uint32x4_t) __builtin_neon_vclezq_v((int8x16_t)__p0, 50);
43715 return __ret;
43716}
43717#else
43718__ai uint32x4_t vclezq_s32(int32x4_t __p0) {
43719 uint32x4_t __ret;
43720 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
43721 __ret = (uint32x4_t) __builtin_neon_vclezq_v((int8x16_t)__rev0, 50);
43722 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
4348243723 return __ret;
4348343724}
4348443725#endif
4348543726
4348643727#ifdef __LITTLE_ENDIAN__
43487__ai float32x2_t vfma_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
43488 float32x2_t __ret;
43489 __ret = (float32x2_t) __builtin_neon_vfma_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
43728__ai uint64x2_t vclezq_s64(int64x2_t __p0) {
43729 uint64x2_t __ret;
43730 __ret = (uint64x2_t) __builtin_neon_vclezq_v((int8x16_t)__p0, 51);
4349043731 return __ret;
4349143732}
4349243733#else
43493__ai float32x2_t vfma_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
43494 float32x2_t __ret;
43495 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43496 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
43497 float32x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
43498 __ret = (float32x2_t) __builtin_neon_vfma_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 9);
43734__ai uint64x2_t vclezq_s64(int64x2_t __p0) {
43735 uint64x2_t __ret;
43736 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43737 __ret = (uint64x2_t) __builtin_neon_vclezq_v((int8x16_t)__rev0, 51);
4349943738 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4350043739 return __ret;
4350143740}
43502__ai float32x2_t __noswap_vfma_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
43503 float32x2_t __ret;
43504 __ret = (float32x2_t) __builtin_neon_vfma_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
43505 return __ret;
43506}
4350743741#endif
4350843742
4350943743#ifdef __LITTLE_ENDIAN__
43510__ai float32x4_t vfmaq_n_f32(float32x4_t __p0, float32x4_t __p1, float32_t __p2) {
43511 float32x4_t __ret;
43512 __ret = vfmaq_f32(__p0, __p1, (float32x4_t) {__p2, __p2, __p2, __p2});
43744__ai uint16x8_t vclezq_s16(int16x8_t __p0) {
43745 uint16x8_t __ret;
43746 __ret = (uint16x8_t) __builtin_neon_vclezq_v((int8x16_t)__p0, 49);
4351343747 return __ret;
4351443748}
4351543749#else
43516__ai float32x4_t vfmaq_n_f32(float32x4_t __p0, float32x4_t __p1, float32_t __p2) {
43517 float32x4_t __ret;
43518 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
43519 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
43520 __ret = __noswap_vfmaq_f32(__rev0, __rev1, (float32x4_t) {__p2, __p2, __p2, __p2});
43521 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
43750__ai uint16x8_t vclezq_s16(int16x8_t __p0) {
43751 uint16x8_t __ret;
43752 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
43753 __ret = (uint16x8_t) __builtin_neon_vclezq_v((int8x16_t)__rev0, 49);
43754 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
4352243755 return __ret;
4352343756}
4352443757#endif
4352543758
4352643759#ifdef __LITTLE_ENDIAN__
43527__ai float32x2_t vfma_n_f32(float32x2_t __p0, float32x2_t __p1, float32_t __p2) {
43528 float32x2_t __ret;
43529 __ret = vfma_f32(__p0, __p1, (float32x2_t) {__p2, __p2});
43760__ai uint8x8_t vclez_s8(int8x8_t __p0) {
43761 uint8x8_t __ret;
43762 __ret = (uint8x8_t) __builtin_neon_vclez_v((int8x8_t)__p0, 16);
4353043763 return __ret;
4353143764}
4353243765#else
43533__ai float32x2_t vfma_n_f32(float32x2_t __p0, float32x2_t __p1, float32_t __p2) {
43534 float32x2_t __ret;
43535 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43536 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
43537 __ret = __noswap_vfma_f32(__rev0, __rev1, (float32x2_t) {__p2, __p2});
43538 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
43766__ai uint8x8_t vclez_s8(int8x8_t __p0) {
43767 uint8x8_t __ret;
43768 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
43769 __ret = (uint8x8_t) __builtin_neon_vclez_v((int8x8_t)__rev0, 16);
43770 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
4353943771 return __ret;
4354043772}
4354143773#endif
4354243774
43775__ai uint64x1_t vclez_f64(float64x1_t __p0) {
43776 uint64x1_t __ret;
43777 __ret = (uint64x1_t) __builtin_neon_vclez_v((int8x8_t)__p0, 19);
43778 return __ret;
43779}
4354343780#ifdef __LITTLE_ENDIAN__
43544__ai float32x4_t vfmsq_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
43545 float32x4_t __ret;
43546 __ret = vfmaq_f32(__p0, -__p1, __p2);
43781__ai uint32x2_t vclez_f32(float32x2_t __p0) {
43782 uint32x2_t __ret;
43783 __ret = (uint32x2_t) __builtin_neon_vclez_v((int8x8_t)__p0, 18);
4354743784 return __ret;
4354843785}
4354943786#else
43550__ai float32x4_t vfmsq_f32(float32x4_t __p0, float32x4_t __p1, float32x4_t __p2) {
43551 float32x4_t __ret;
43552 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
43553 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
43554 float32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
43555 __ret = __noswap_vfmaq_f32(__rev0, -__rev1, __rev2);
43556 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
43787__ai uint32x2_t vclez_f32(float32x2_t __p0) {
43788 uint32x2_t __ret;
43789 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43790 __ret = (uint32x2_t) __builtin_neon_vclez_v((int8x8_t)__rev0, 18);
43791 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4355743792 return __ret;
4355843793}
4355943794#endif
4356043795
4356143796#ifdef __LITTLE_ENDIAN__
43562__ai float32x2_t vfms_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
43563 float32x2_t __ret;
43564 __ret = vfma_f32(__p0, -__p1, __p2);
43797__ai uint32x2_t vclez_s32(int32x2_t __p0) {
43798 uint32x2_t __ret;
43799 __ret = (uint32x2_t) __builtin_neon_vclez_v((int8x8_t)__p0, 18);
4356543800 return __ret;
4356643801}
4356743802#else
43568__ai float32x2_t vfms_f32(float32x2_t __p0, float32x2_t __p1, float32x2_t __p2) {
43569 float32x2_t __ret;
43570 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43571 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
43572 float32x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
43573 __ret = __noswap_vfma_f32(__rev0, -__rev1, __rev2);
43803__ai uint32x2_t vclez_s32(int32x2_t __p0) {
43804 uint32x2_t __ret;
43805 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43806 __ret = (uint32x2_t) __builtin_neon_vclez_v((int8x8_t)__rev0, 18);
4357443807 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4357543808 return __ret;
4357643809}
4357743810#endif
4357843811
43579#endif
43580#if defined(__ARM_FEATURE_FP16_FML) && defined(__aarch64__)
43812__ai uint64x1_t vclez_s64(int64x1_t __p0) {
43813 uint64x1_t __ret;
43814 __ret = (uint64x1_t) __builtin_neon_vclez_v((int8x8_t)__p0, 19);
43815 return __ret;
43816}
4358143817#ifdef __LITTLE_ENDIAN__
43582__ai float32x4_t vfmlalq_high_f16(float32x4_t __p0, float16x8_t __p1, float16x8_t __p2) {
43583 float32x4_t __ret;
43584 __ret = (float32x4_t) __builtin_neon_vfmlalq_high_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
43818__ai uint16x4_t vclez_s16(int16x4_t __p0) {
43819 uint16x4_t __ret;
43820 __ret = (uint16x4_t) __builtin_neon_vclez_v((int8x8_t)__p0, 17);
4358543821 return __ret;
4358643822}
4358743823#else
43588__ai float32x4_t vfmlalq_high_f16(float32x4_t __p0, float16x8_t __p1, float16x8_t __p2) {
43589 float32x4_t __ret;
43590 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
43591 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
43592 float16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
43593 __ret = (float32x4_t) __builtin_neon_vfmlalq_high_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 41);
43824__ai uint16x4_t vclez_s16(int16x4_t __p0) {
43825 uint16x4_t __ret;
43826 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
43827 __ret = (uint16x4_t) __builtin_neon_vclez_v((int8x8_t)__rev0, 17);
4359443828 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
4359543829 return __ret;
4359643830}
43597__ai float32x4_t __noswap_vfmlalq_high_f16(float32x4_t __p0, float16x8_t __p1, float16x8_t __p2) {
43598 float32x4_t __ret;
43599 __ret = (float32x4_t) __builtin_neon_vfmlalq_high_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
43600 return __ret;
43601}
4360243831#endif
4360343832
43833__ai uint64_t vclezd_s64(int64_t __p0) {
43834 uint64_t __ret;
43835 __ret = (uint64_t) __builtin_neon_vclezd_s64(__p0);
43836 return __ret;
43837}
43838__ai uint64_t vclezd_f64(float64_t __p0) {
43839 uint64_t __ret;
43840 __ret = (uint64_t) __builtin_neon_vclezd_f64(__p0);
43841 return __ret;
43842}
43843__ai uint32_t vclezs_f32(float32_t __p0) {
43844 uint32_t __ret;
43845 __ret = (uint32_t) __builtin_neon_vclezs_f32(__p0);
43846 return __ret;
43847}
4360443848#ifdef __LITTLE_ENDIAN__
43605__ai float32x2_t vfmlal_high_f16(float32x2_t __p0, float16x4_t __p1, float16x4_t __p2) {
43606 float32x2_t __ret;
43607 __ret = (float32x2_t) __builtin_neon_vfmlal_high_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
43849__ai uint64x2_t vcltq_u64(uint64x2_t __p0, uint64x2_t __p1) {
43850 uint64x2_t __ret;
43851 __ret = (uint64x2_t)(__p0 < __p1);
4360843852 return __ret;
4360943853}
4361043854#else
43611__ai float32x2_t vfmlal_high_f16(float32x2_t __p0, float16x4_t __p1, float16x4_t __p2) {
43612 float32x2_t __ret;
43613 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43614 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
43615 float16x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
43616 __ret = (float32x2_t) __builtin_neon_vfmlal_high_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 9);
43855__ai uint64x2_t vcltq_u64(uint64x2_t __p0, uint64x2_t __p1) {
43856 uint64x2_t __ret;
43857 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43858 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
43859 __ret = (uint64x2_t)(__rev0 < __rev1);
4361743860 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4361843861 return __ret;
4361943862}
43620__ai float32x2_t __noswap_vfmlal_high_f16(float32x2_t __p0, float16x4_t __p1, float16x4_t __p2) {
43621 float32x2_t __ret;
43622 __ret = (float32x2_t) __builtin_neon_vfmlal_high_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
43623 return __ret;
43624}
4362543863#endif
4362643864
4362743865#ifdef __LITTLE_ENDIAN__
43628__ai float32x4_t vfmlalq_low_f16(float32x4_t __p0, float16x8_t __p1, float16x8_t __p2) {
43629 float32x4_t __ret;
43630 __ret = (float32x4_t) __builtin_neon_vfmlalq_low_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
43866__ai uint64x2_t vcltq_f64(float64x2_t __p0, float64x2_t __p1) {
43867 uint64x2_t __ret;
43868 __ret = (uint64x2_t)(__p0 < __p1);
4363143869 return __ret;
4363243870}
4363343871#else
43634__ai float32x4_t vfmlalq_low_f16(float32x4_t __p0, float16x8_t __p1, float16x8_t __p2) {
43635 float32x4_t __ret;
43636 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
43637 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
43638 float16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
43639 __ret = (float32x4_t) __builtin_neon_vfmlalq_low_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 41);
43640 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
43641 return __ret;
43642}
43643__ai float32x4_t __noswap_vfmlalq_low_f16(float32x4_t __p0, float16x8_t __p1, float16x8_t __p2) {
43644 float32x4_t __ret;
43645 __ret = (float32x4_t) __builtin_neon_vfmlalq_low_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
43872__ai uint64x2_t vcltq_f64(float64x2_t __p0, float64x2_t __p1) {
43873 uint64x2_t __ret;
43874 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43875 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
43876 __ret = (uint64x2_t)(__rev0 < __rev1);
43877 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4364643878 return __ret;
4364743879}
4364843880#endif
4364943881
4365043882#ifdef __LITTLE_ENDIAN__
43651__ai float32x2_t vfmlal_low_f16(float32x2_t __p0, float16x4_t __p1, float16x4_t __p2) {
43652 float32x2_t __ret;
43653 __ret = (float32x2_t) __builtin_neon_vfmlal_low_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
43883__ai uint64x2_t vcltq_s64(int64x2_t __p0, int64x2_t __p1) {
43884 uint64x2_t __ret;
43885 __ret = (uint64x2_t)(__p0 < __p1);
4365443886 return __ret;
4365543887}
4365643888#else
43657__ai float32x2_t vfmlal_low_f16(float32x2_t __p0, float16x4_t __p1, float16x4_t __p2) {
43658 float32x2_t __ret;
43659 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43660 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
43661 float16x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
43662 __ret = (float32x2_t) __builtin_neon_vfmlal_low_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 9);
43889__ai uint64x2_t vcltq_s64(int64x2_t __p0, int64x2_t __p1) {
43890 uint64x2_t __ret;
43891 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43892 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
43893 __ret = (uint64x2_t)(__rev0 < __rev1);
4366343894 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4366443895 return __ret;
4366543896}
43666__ai float32x2_t __noswap_vfmlal_low_f16(float32x2_t __p0, float16x4_t __p1, float16x4_t __p2) {
43667 float32x2_t __ret;
43668 __ret = (float32x2_t) __builtin_neon_vfmlal_low_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
43669 return __ret;
43670}
4367143897#endif
4367243898
43673#ifdef __LITTLE_ENDIAN__
43674__ai float32x4_t vfmlslq_high_f16(float32x4_t __p0, float16x8_t __p1, float16x8_t __p2) {
43675 float32x4_t __ret;
43676 __ret = (float32x4_t) __builtin_neon_vfmlslq_high_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
43899__ai uint64x1_t vclt_u64(uint64x1_t __p0, uint64x1_t __p1) {
43900 uint64x1_t __ret;
43901 __ret = (uint64x1_t)(__p0 < __p1);
4367743902 return __ret;
4367843903}
43679#else
43680__ai float32x4_t vfmlslq_high_f16(float32x4_t __p0, float16x8_t __p1, float16x8_t __p2) {
43681 float32x4_t __ret;
43682 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
43683 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
43684 float16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
43685 __ret = (float32x4_t) __builtin_neon_vfmlslq_high_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 41);
43686 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
43904__ai uint64x1_t vclt_f64(float64x1_t __p0, float64x1_t __p1) {
43905 uint64x1_t __ret;
43906 __ret = (uint64x1_t)(__p0 < __p1);
4368743907 return __ret;
4368843908}
43689__ai float32x4_t __noswap_vfmlslq_high_f16(float32x4_t __p0, float16x8_t __p1, float16x8_t __p2) {
43690 float32x4_t __ret;
43691 __ret = (float32x4_t) __builtin_neon_vfmlslq_high_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
43909__ai uint64x1_t vclt_s64(int64x1_t __p0, int64x1_t __p1) {
43910 uint64x1_t __ret;
43911 __ret = (uint64x1_t)(__p0 < __p1);
4369243912 return __ret;
4369343913}
43694#endif
43695
43696#ifdef __LITTLE_ENDIAN__
43697__ai float32x2_t vfmlsl_high_f16(float32x2_t __p0, float16x4_t __p1, float16x4_t __p2) {
43698 float32x2_t __ret;
43699 __ret = (float32x2_t) __builtin_neon_vfmlsl_high_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
43914__ai uint64_t vcltd_u64(uint64_t __p0, uint64_t __p1) {
43915 uint64_t __ret;
43916 __ret = (uint64_t) __builtin_neon_vcltd_u64(__p0, __p1);
4370043917 return __ret;
4370143918}
43702#else
43703__ai float32x2_t vfmlsl_high_f16(float32x2_t __p0, float16x4_t __p1, float16x4_t __p2) {
43704 float32x2_t __ret;
43705 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43706 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
43707 float16x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
43708 __ret = (float32x2_t) __builtin_neon_vfmlsl_high_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 9);
43709 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
43919__ai uint64_t vcltd_s64(int64_t __p0, int64_t __p1) {
43920 uint64_t __ret;
43921 __ret = (uint64_t) __builtin_neon_vcltd_s64(__p0, __p1);
4371043922 return __ret;
4371143923}
43712__ai float32x2_t __noswap_vfmlsl_high_f16(float32x2_t __p0, float16x4_t __p1, float16x4_t __p2) {
43713 float32x2_t __ret;
43714 __ret = (float32x2_t) __builtin_neon_vfmlsl_high_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
43924__ai uint64_t vcltd_f64(float64_t __p0, float64_t __p1) {
43925 uint64_t __ret;
43926 __ret = (uint64_t) __builtin_neon_vcltd_f64(__p0, __p1);
4371543927 return __ret;
4371643928}
43717#endif
43718
43719#ifdef __LITTLE_ENDIAN__
43720__ai float32x4_t vfmlslq_low_f16(float32x4_t __p0, float16x8_t __p1, float16x8_t __p2) {
43721 float32x4_t __ret;
43722 __ret = (float32x4_t) __builtin_neon_vfmlslq_low_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
43929__ai uint32_t vclts_f32(float32_t __p0, float32_t __p1) {
43930 uint32_t __ret;
43931 __ret = (uint32_t) __builtin_neon_vclts_f32(__p0, __p1);
4372343932 return __ret;
4372443933}
43725#else
43726__ai float32x4_t vfmlslq_low_f16(float32x4_t __p0, float16x8_t __p1, float16x8_t __p2) {
43727 float32x4_t __ret;
43728 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
43729 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
43730 float16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
43731 __ret = (float32x4_t) __builtin_neon_vfmlslq_low_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 41);
43732 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
43934#ifdef __LITTLE_ENDIAN__
43935__ai uint8x16_t vcltzq_s8(int8x16_t __p0) {
43936 uint8x16_t __ret;
43937 __ret = (uint8x16_t) __builtin_neon_vcltzq_v((int8x16_t)__p0, 48);
4373343938 return __ret;
4373443939}
43735__ai float32x4_t __noswap_vfmlslq_low_f16(float32x4_t __p0, float16x8_t __p1, float16x8_t __p2) {
43736 float32x4_t __ret;
43737 __ret = (float32x4_t) __builtin_neon_vfmlslq_low_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
43940#else
43941__ai uint8x16_t vcltzq_s8(int8x16_t __p0) {
43942 uint8x16_t __ret;
43943 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
43944 __ret = (uint8x16_t) __builtin_neon_vcltzq_v((int8x16_t)__rev0, 48);
43945 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
4373843946 return __ret;
4373943947}
4374043948#endif
4374143949
4374243950#ifdef __LITTLE_ENDIAN__
43743__ai float32x2_t vfmlsl_low_f16(float32x2_t __p0, float16x4_t __p1, float16x4_t __p2) {
43744 float32x2_t __ret;
43745 __ret = (float32x2_t) __builtin_neon_vfmlsl_low_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
43951__ai uint64x2_t vcltzq_f64(float64x2_t __p0) {
43952 uint64x2_t __ret;
43953 __ret = (uint64x2_t) __builtin_neon_vcltzq_v((int8x16_t)__p0, 51);
4374643954 return __ret;
4374743955}
4374843956#else
43749__ai float32x2_t vfmlsl_low_f16(float32x2_t __p0, float16x4_t __p1, float16x4_t __p2) {
43750 float32x2_t __ret;
43751 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43752 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
43753 float16x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
43754 __ret = (float32x2_t) __builtin_neon_vfmlsl_low_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 9);
43957__ai uint64x2_t vcltzq_f64(float64x2_t __p0) {
43958 uint64x2_t __ret;
43959 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
43960 __ret = (uint64x2_t) __builtin_neon_vcltzq_v((int8x16_t)__rev0, 51);
4375543961 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4375643962 return __ret;
4375743963}
43758__ai float32x2_t __noswap_vfmlsl_low_f16(float32x2_t __p0, float16x4_t __p1, float16x4_t __p2) {
43759 float32x2_t __ret;
43760 __ret = (float32x2_t) __builtin_neon_vfmlsl_low_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
43761 return __ret;
43762}
4376343964#endif
4376443965
43765#endif
43766#if defined(__ARM_FEATURE_FP16_VECTOR_ARITHMETIC)
4376743966#ifdef __LITTLE_ENDIAN__
43768__ai float16x8_t vabdq_f16(float16x8_t __p0, float16x8_t __p1) {
43769 float16x8_t __ret;
43770 __ret = (float16x8_t) __builtin_neon_vabdq_v((int8x16_t)__p0, (int8x16_t)__p1, 40);
43967__ai uint32x4_t vcltzq_f32(float32x4_t __p0) {
43968 uint32x4_t __ret;
43969 __ret = (uint32x4_t) __builtin_neon_vcltzq_v((int8x16_t)__p0, 50);
4377143970 return __ret;
4377243971}
4377343972#else
43774__ai float16x8_t vabdq_f16(float16x8_t __p0, float16x8_t __p1) {
43775 float16x8_t __ret;
43776 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
43777 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
43778 __ret = (float16x8_t) __builtin_neon_vabdq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
43779 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
43973__ai uint32x4_t vcltzq_f32(float32x4_t __p0) {
43974 uint32x4_t __ret;
43975 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
43976 __ret = (uint32x4_t) __builtin_neon_vcltzq_v((int8x16_t)__rev0, 50);
43977 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
4378043978 return __ret;
4378143979}
4378243980#endif
4378343981
4378443982#ifdef __LITTLE_ENDIAN__
43785__ai float16x4_t vabd_f16(float16x4_t __p0, float16x4_t __p1) {
43786 float16x4_t __ret;
43787 __ret = (float16x4_t) __builtin_neon_vabd_v((int8x8_t)__p0, (int8x8_t)__p1, 8);
43983__ai uint32x4_t vcltzq_s32(int32x4_t __p0) {
43984 uint32x4_t __ret;
43985 __ret = (uint32x4_t) __builtin_neon_vcltzq_v((int8x16_t)__p0, 50);
4378843986 return __ret;
4378943987}
4379043988#else
43791__ai float16x4_t vabd_f16(float16x4_t __p0, float16x4_t __p1) {
43792 float16x4_t __ret;
43793 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
43794 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
43795 __ret = (float16x4_t) __builtin_neon_vabd_v((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
43989__ai uint32x4_t vcltzq_s32(int32x4_t __p0) {
43990 uint32x4_t __ret;
43991 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
43992 __ret = (uint32x4_t) __builtin_neon_vcltzq_v((int8x16_t)__rev0, 50);
4379643993 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
4379743994 return __ret;
4379843995}
4379943996#endif
4380043997
4380143998#ifdef __LITTLE_ENDIAN__
43802__ai float16x8_t vabsq_f16(float16x8_t __p0) {
43803 float16x8_t __ret;
43804 __ret = (float16x8_t) __builtin_neon_vabsq_v((int8x16_t)__p0, 40);
43999__ai uint64x2_t vcltzq_s64(int64x2_t __p0) {
44000 uint64x2_t __ret;
44001 __ret = (uint64x2_t) __builtin_neon_vcltzq_v((int8x16_t)__p0, 51);
4380544002 return __ret;
4380644003}
4380744004#else
43808__ai float16x8_t vabsq_f16(float16x8_t __p0) {
43809 float16x8_t __ret;
43810 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
43811 __ret = (float16x8_t) __builtin_neon_vabsq_v((int8x16_t)__rev0, 40);
43812 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
44005__ai uint64x2_t vcltzq_s64(int64x2_t __p0) {
44006 uint64x2_t __ret;
44007 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
44008 __ret = (uint64x2_t) __builtin_neon_vcltzq_v((int8x16_t)__rev0, 51);
44009 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4381344010 return __ret;
4381444011}
4381544012#endif
4381644013
4381744014#ifdef __LITTLE_ENDIAN__
43818__ai float16x4_t vabs_f16(float16x4_t __p0) {
43819 float16x4_t __ret;
43820 __ret = (float16x4_t) __builtin_neon_vabs_v((int8x8_t)__p0, 8);
44015__ai uint16x8_t vcltzq_s16(int16x8_t __p0) {
44016 uint16x8_t __ret;
44017 __ret = (uint16x8_t) __builtin_neon_vcltzq_v((int8x16_t)__p0, 49);
4382144018 return __ret;
4382244019}
4382344020#else
43824__ai float16x4_t vabs_f16(float16x4_t __p0) {
43825 float16x4_t __ret;
43826 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
43827 __ret = (float16x4_t) __builtin_neon_vabs_v((int8x8_t)__rev0, 8);
43828 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
44021__ai uint16x8_t vcltzq_s16(int16x8_t __p0) {
44022 uint16x8_t __ret;
44023 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
44024 __ret = (uint16x8_t) __builtin_neon_vcltzq_v((int8x16_t)__rev0, 49);
44025 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
4382944026 return __ret;
4383044027}
4383144028#endif
4383244029
4383344030#ifdef __LITTLE_ENDIAN__
43834__ai float16x8_t vaddq_f16(float16x8_t __p0, float16x8_t __p1) {
43835 float16x8_t __ret;
43836 __ret = __p0 + __p1;
44031__ai uint8x8_t vcltz_s8(int8x8_t __p0) {
44032 uint8x8_t __ret;
44033 __ret = (uint8x8_t) __builtin_neon_vcltz_v((int8x8_t)__p0, 16);
4383744034 return __ret;
4383844035}
4383944036#else
43840__ai float16x8_t vaddq_f16(float16x8_t __p0, float16x8_t __p1) {
43841 float16x8_t __ret;
43842 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
43843 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
43844 __ret = __rev0 + __rev1;
44037__ai uint8x8_t vcltz_s8(int8x8_t __p0) {
44038 uint8x8_t __ret;
44039 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
44040 __ret = (uint8x8_t) __builtin_neon_vcltz_v((int8x8_t)__rev0, 16);
4384544041 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
4384644042 return __ret;
4384744043}
4384844044#endif
4384944045
44046__ai uint64x1_t vcltz_f64(float64x1_t __p0) {
44047 uint64x1_t __ret;
44048 __ret = (uint64x1_t) __builtin_neon_vcltz_v((int8x8_t)__p0, 19);
44049 return __ret;
44050}
4385044051#ifdef __LITTLE_ENDIAN__
43851__ai float16x4_t vadd_f16(float16x4_t __p0, float16x4_t __p1) {
43852 float16x4_t __ret;
43853 __ret = __p0 + __p1;
44052__ai uint32x2_t vcltz_f32(float32x2_t __p0) {
44053 uint32x2_t __ret;
44054 __ret = (uint32x2_t) __builtin_neon_vcltz_v((int8x8_t)__p0, 18);
4385444055 return __ret;
4385544056}
4385644057#else
43857__ai float16x4_t vadd_f16(float16x4_t __p0, float16x4_t __p1) {
43858 float16x4_t __ret;
43859 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
43860 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
43861 __ret = __rev0 + __rev1;
43862 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
44058__ai uint32x2_t vcltz_f32(float32x2_t __p0) {
44059 uint32x2_t __ret;
44060 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
44061 __ret = (uint32x2_t) __builtin_neon_vcltz_v((int8x8_t)__rev0, 18);
44062 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4386344063 return __ret;
4386444064}
4386544065#endif
4386644066
4386744067#ifdef __LITTLE_ENDIAN__
43868__ai float16x8_t vbslq_f16(uint16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
43869 float16x8_t __ret;
43870 __ret = (float16x8_t) __builtin_neon_vbslq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 40);
44068__ai uint32x2_t vcltz_s32(int32x2_t __p0) {
44069 uint32x2_t __ret;
44070 __ret = (uint32x2_t) __builtin_neon_vcltz_v((int8x8_t)__p0, 18);
4387144071 return __ret;
4387244072}
4387344073#else
43874__ai float16x8_t vbslq_f16(uint16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
43875 float16x8_t __ret;
43876 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
43877 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
43878 float16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
43879 __ret = (float16x8_t) __builtin_neon_vbslq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 40);
43880 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
44074__ai uint32x2_t vcltz_s32(int32x2_t __p0) {
44075 uint32x2_t __ret;
44076 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
44077 __ret = (uint32x2_t) __builtin_neon_vcltz_v((int8x8_t)__rev0, 18);
44078 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4388144079 return __ret;
4388244080}
4388344081#endif
4388444082
44083__ai uint64x1_t vcltz_s64(int64x1_t __p0) {
44084 uint64x1_t __ret;
44085 __ret = (uint64x1_t) __builtin_neon_vcltz_v((int8x8_t)__p0, 19);
44086 return __ret;
44087}
4388544088#ifdef __LITTLE_ENDIAN__
43886__ai float16x4_t vbsl_f16(uint16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
43887 float16x4_t __ret;
43888 __ret = (float16x4_t) __builtin_neon_vbsl_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 8);
44089__ai uint16x4_t vcltz_s16(int16x4_t __p0) {
44090 uint16x4_t __ret;
44091 __ret = (uint16x4_t) __builtin_neon_vcltz_v((int8x8_t)__p0, 17);
4388944092 return __ret;
4389044093}
4389144094#else
43892__ai float16x4_t vbsl_f16(uint16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
43893 float16x4_t __ret;
43894 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
43895 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
43896 float16x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
43897 __ret = (float16x4_t) __builtin_neon_vbsl_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 8);
44095__ai uint16x4_t vcltz_s16(int16x4_t __p0) {
44096 uint16x4_t __ret;
44097 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
44098 __ret = (uint16x4_t) __builtin_neon_vcltz_v((int8x8_t)__rev0, 17);
4389844099 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
4389944100 return __ret;
4390044101}
4390144102#endif
4390244103
44104__ai uint64_t vcltzd_s64(int64_t __p0) {
44105 uint64_t __ret;
44106 __ret = (uint64_t) __builtin_neon_vcltzd_s64(__p0);
44107 return __ret;
44108}
44109__ai uint64_t vcltzd_f64(float64_t __p0) {
44110 uint64_t __ret;
44111 __ret = (uint64_t) __builtin_neon_vcltzd_f64(__p0);
44112 return __ret;
44113}
44114__ai uint32_t vcltzs_f32(float32_t __p0) {
44115 uint32_t __ret;
44116 __ret = (uint32_t) __builtin_neon_vcltzs_f32(__p0);
44117 return __ret;
44118}
4390344119#ifdef __LITTLE_ENDIAN__
43904__ai uint16x8_t vcageq_f16(float16x8_t __p0, float16x8_t __p1) {
43905 uint16x8_t __ret;
43906 __ret = (uint16x8_t) __builtin_neon_vcageq_v((int8x16_t)__p0, (int8x16_t)__p1, 49);
44120__ai poly64x2_t vcombine_p64(poly64x1_t __p0, poly64x1_t __p1) {
44121 poly64x2_t __ret;
44122 __ret = __builtin_shufflevector(__p0, __p1, 0, 1);
4390744123 return __ret;
4390844124}
4390944125#else
43910__ai uint16x8_t vcageq_f16(float16x8_t __p0, float16x8_t __p1) {
43911 uint16x8_t __ret;
43912 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
43913 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
43914 __ret = (uint16x8_t) __builtin_neon_vcageq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 49);
43915 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
44126__ai poly64x2_t vcombine_p64(poly64x1_t __p0, poly64x1_t __p1) {
44127 poly64x2_t __ret;
44128 __ret = __builtin_shufflevector(__p0, __p1, 0, 1);
44129 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4391644130 return __ret;
4391744131}
4391844132#endif
4391944133
4392044134#ifdef __LITTLE_ENDIAN__
43921__ai uint16x4_t vcage_f16(float16x4_t __p0, float16x4_t __p1) {
43922 uint16x4_t __ret;
43923 __ret = (uint16x4_t) __builtin_neon_vcage_v((int8x8_t)__p0, (int8x8_t)__p1, 17);
44135__ai float64x2_t vcombine_f64(float64x1_t __p0, float64x1_t __p1) {
44136 float64x2_t __ret;
44137 __ret = __builtin_shufflevector(__p0, __p1, 0, 1);
4392444138 return __ret;
4392544139}
4392644140#else
43927__ai uint16x4_t vcage_f16(float16x4_t __p0, float16x4_t __p1) {
43928 uint16x4_t __ret;
43929 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
43930 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
43931 __ret = (uint16x4_t) __builtin_neon_vcage_v((int8x8_t)__rev0, (int8x8_t)__rev1, 17);
43932 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
43933 return __ret;
43934}
44141__ai float64x2_t vcombine_f64(float64x1_t __p0, float64x1_t __p1) {
44142 float64x2_t __ret;
44143 __ret = __builtin_shufflevector(__p0, __p1, 0, 1);
44144 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
44145 return __ret;
44146}
44147#endif
44148
44149#ifdef __LITTLE_ENDIAN__
44150#define vcopyq_lane_p8(__p0_257, __p1_257, __p2_257, __p3_257) __extension__ ({ \
44151 poly8x16_t __ret_257; \
44152 poly8x16_t __s0_257 = __p0_257; \
44153 poly8x8_t __s2_257 = __p2_257; \
44154 __ret_257 = vsetq_lane_p8(vget_lane_p8(__s2_257, __p3_257), __s0_257, __p1_257); \
44155 __ret_257; \
44156})
44157#else
44158#define vcopyq_lane_p8(__p0_258, __p1_258, __p2_258, __p3_258) __extension__ ({ \
44159 poly8x16_t __ret_258; \
44160 poly8x16_t __s0_258 = __p0_258; \
44161 poly8x8_t __s2_258 = __p2_258; \
44162 poly8x16_t __rev0_258; __rev0_258 = __builtin_shufflevector(__s0_258, __s0_258, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
44163 poly8x8_t __rev2_258; __rev2_258 = __builtin_shufflevector(__s2_258, __s2_258, 7, 6, 5, 4, 3, 2, 1, 0); \
44164 __ret_258 = __noswap_vsetq_lane_p8(__noswap_vget_lane_p8(__rev2_258, __p3_258), __rev0_258, __p1_258); \
44165 __ret_258 = __builtin_shufflevector(__ret_258, __ret_258, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
44166 __ret_258; \
44167})
44168#endif
44169
44170#ifdef __LITTLE_ENDIAN__
44171#define vcopyq_lane_p16(__p0_259, __p1_259, __p2_259, __p3_259) __extension__ ({ \
44172 poly16x8_t __ret_259; \
44173 poly16x8_t __s0_259 = __p0_259; \
44174 poly16x4_t __s2_259 = __p2_259; \
44175 __ret_259 = vsetq_lane_p16(vget_lane_p16(__s2_259, __p3_259), __s0_259, __p1_259); \
44176 __ret_259; \
44177})
44178#else
44179#define vcopyq_lane_p16(__p0_260, __p1_260, __p2_260, __p3_260) __extension__ ({ \
44180 poly16x8_t __ret_260; \
44181 poly16x8_t __s0_260 = __p0_260; \
44182 poly16x4_t __s2_260 = __p2_260; \
44183 poly16x8_t __rev0_260; __rev0_260 = __builtin_shufflevector(__s0_260, __s0_260, 7, 6, 5, 4, 3, 2, 1, 0); \
44184 poly16x4_t __rev2_260; __rev2_260 = __builtin_shufflevector(__s2_260, __s2_260, 3, 2, 1, 0); \
44185 __ret_260 = __noswap_vsetq_lane_p16(__noswap_vget_lane_p16(__rev2_260, __p3_260), __rev0_260, __p1_260); \
44186 __ret_260 = __builtin_shufflevector(__ret_260, __ret_260, 7, 6, 5, 4, 3, 2, 1, 0); \
44187 __ret_260; \
44188})
44189#endif
44190
44191#ifdef __LITTLE_ENDIAN__
44192#define vcopyq_lane_u8(__p0_261, __p1_261, __p2_261, __p3_261) __extension__ ({ \
44193 uint8x16_t __ret_261; \
44194 uint8x16_t __s0_261 = __p0_261; \
44195 uint8x8_t __s2_261 = __p2_261; \
44196 __ret_261 = vsetq_lane_u8(vget_lane_u8(__s2_261, __p3_261), __s0_261, __p1_261); \
44197 __ret_261; \
44198})
44199#else
44200#define vcopyq_lane_u8(__p0_262, __p1_262, __p2_262, __p3_262) __extension__ ({ \
44201 uint8x16_t __ret_262; \
44202 uint8x16_t __s0_262 = __p0_262; \
44203 uint8x8_t __s2_262 = __p2_262; \
44204 uint8x16_t __rev0_262; __rev0_262 = __builtin_shufflevector(__s0_262, __s0_262, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
44205 uint8x8_t __rev2_262; __rev2_262 = __builtin_shufflevector(__s2_262, __s2_262, 7, 6, 5, 4, 3, 2, 1, 0); \
44206 __ret_262 = __noswap_vsetq_lane_u8(__noswap_vget_lane_u8(__rev2_262, __p3_262), __rev0_262, __p1_262); \
44207 __ret_262 = __builtin_shufflevector(__ret_262, __ret_262, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
44208 __ret_262; \
44209})
44210#endif
44211
44212#ifdef __LITTLE_ENDIAN__
44213#define vcopyq_lane_u32(__p0_263, __p1_263, __p2_263, __p3_263) __extension__ ({ \
44214 uint32x4_t __ret_263; \
44215 uint32x4_t __s0_263 = __p0_263; \
44216 uint32x2_t __s2_263 = __p2_263; \
44217 __ret_263 = vsetq_lane_u32(vget_lane_u32(__s2_263, __p3_263), __s0_263, __p1_263); \
44218 __ret_263; \
44219})
44220#else
44221#define vcopyq_lane_u32(__p0_264, __p1_264, __p2_264, __p3_264) __extension__ ({ \
44222 uint32x4_t __ret_264; \
44223 uint32x4_t __s0_264 = __p0_264; \
44224 uint32x2_t __s2_264 = __p2_264; \
44225 uint32x4_t __rev0_264; __rev0_264 = __builtin_shufflevector(__s0_264, __s0_264, 3, 2, 1, 0); \
44226 uint32x2_t __rev2_264; __rev2_264 = __builtin_shufflevector(__s2_264, __s2_264, 1, 0); \
44227 __ret_264 = __noswap_vsetq_lane_u32(__noswap_vget_lane_u32(__rev2_264, __p3_264), __rev0_264, __p1_264); \
44228 __ret_264 = __builtin_shufflevector(__ret_264, __ret_264, 3, 2, 1, 0); \
44229 __ret_264; \
44230})
44231#endif
44232
44233#ifdef __LITTLE_ENDIAN__
44234#define vcopyq_lane_u64(__p0_265, __p1_265, __p2_265, __p3_265) __extension__ ({ \
44235 uint64x2_t __ret_265; \
44236 uint64x2_t __s0_265 = __p0_265; \
44237 uint64x1_t __s2_265 = __p2_265; \
44238 __ret_265 = vsetq_lane_u64(vget_lane_u64(__s2_265, __p3_265), __s0_265, __p1_265); \
44239 __ret_265; \
44240})
44241#else
44242#define vcopyq_lane_u64(__p0_266, __p1_266, __p2_266, __p3_266) __extension__ ({ \
44243 uint64x2_t __ret_266; \
44244 uint64x2_t __s0_266 = __p0_266; \
44245 uint64x1_t __s2_266 = __p2_266; \
44246 uint64x2_t __rev0_266; __rev0_266 = __builtin_shufflevector(__s0_266, __s0_266, 1, 0); \
44247 __ret_266 = __noswap_vsetq_lane_u64(vget_lane_u64(__s2_266, __p3_266), __rev0_266, __p1_266); \
44248 __ret_266 = __builtin_shufflevector(__ret_266, __ret_266, 1, 0); \
44249 __ret_266; \
44250})
4393544251#endif
4393644252
4393744253#ifdef __LITTLE_ENDIAN__
43938__ai uint16x8_t vcagtq_f16(float16x8_t __p0, float16x8_t __p1) {
43939 uint16x8_t __ret;
43940 __ret = (uint16x8_t) __builtin_neon_vcagtq_v((int8x16_t)__p0, (int8x16_t)__p1, 49);
43941 return __ret;
43942}
44254#define vcopyq_lane_u16(__p0_267, __p1_267, __p2_267, __p3_267) __extension__ ({ \
44255 uint16x8_t __ret_267; \
44256 uint16x8_t __s0_267 = __p0_267; \
44257 uint16x4_t __s2_267 = __p2_267; \
44258 __ret_267 = vsetq_lane_u16(vget_lane_u16(__s2_267, __p3_267), __s0_267, __p1_267); \
44259 __ret_267; \
44260})
4394344261#else
43944__ai uint16x8_t vcagtq_f16(float16x8_t __p0, float16x8_t __p1) {
43945 uint16x8_t __ret;
43946 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
43947 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
43948 __ret = (uint16x8_t) __builtin_neon_vcagtq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 49);
43949 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
43950 return __ret;
43951}
44262#define vcopyq_lane_u16(__p0_268, __p1_268, __p2_268, __p3_268) __extension__ ({ \
44263 uint16x8_t __ret_268; \
44264 uint16x8_t __s0_268 = __p0_268; \
44265 uint16x4_t __s2_268 = __p2_268; \
44266 uint16x8_t __rev0_268; __rev0_268 = __builtin_shufflevector(__s0_268, __s0_268, 7, 6, 5, 4, 3, 2, 1, 0); \
44267 uint16x4_t __rev2_268; __rev2_268 = __builtin_shufflevector(__s2_268, __s2_268, 3, 2, 1, 0); \
44268 __ret_268 = __noswap_vsetq_lane_u16(__noswap_vget_lane_u16(__rev2_268, __p3_268), __rev0_268, __p1_268); \
44269 __ret_268 = __builtin_shufflevector(__ret_268, __ret_268, 7, 6, 5, 4, 3, 2, 1, 0); \
44270 __ret_268; \
44271})
4395244272#endif
4395344273
4395444274#ifdef __LITTLE_ENDIAN__
43955__ai uint16x4_t vcagt_f16(float16x4_t __p0, float16x4_t __p1) {
43956 uint16x4_t __ret;
43957 __ret = (uint16x4_t) __builtin_neon_vcagt_v((int8x8_t)__p0, (int8x8_t)__p1, 17);
43958 return __ret;
43959}
44275#define vcopyq_lane_s8(__p0_269, __p1_269, __p2_269, __p3_269) __extension__ ({ \
44276 int8x16_t __ret_269; \
44277 int8x16_t __s0_269 = __p0_269; \
44278 int8x8_t __s2_269 = __p2_269; \
44279 __ret_269 = vsetq_lane_s8(vget_lane_s8(__s2_269, __p3_269), __s0_269, __p1_269); \
44280 __ret_269; \
44281})
4396044282#else
43961__ai uint16x4_t vcagt_f16(float16x4_t __p0, float16x4_t __p1) {
43962 uint16x4_t __ret;
43963 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
43964 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
43965 __ret = (uint16x4_t) __builtin_neon_vcagt_v((int8x8_t)__rev0, (int8x8_t)__rev1, 17);
43966 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
43967 return __ret;
43968}
44283#define vcopyq_lane_s8(__p0_270, __p1_270, __p2_270, __p3_270) __extension__ ({ \
44284 int8x16_t __ret_270; \
44285 int8x16_t __s0_270 = __p0_270; \
44286 int8x8_t __s2_270 = __p2_270; \
44287 int8x16_t __rev0_270; __rev0_270 = __builtin_shufflevector(__s0_270, __s0_270, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
44288 int8x8_t __rev2_270; __rev2_270 = __builtin_shufflevector(__s2_270, __s2_270, 7, 6, 5, 4, 3, 2, 1, 0); \
44289 __ret_270 = __noswap_vsetq_lane_s8(__noswap_vget_lane_s8(__rev2_270, __p3_270), __rev0_270, __p1_270); \
44290 __ret_270 = __builtin_shufflevector(__ret_270, __ret_270, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
44291 __ret_270; \
44292})
4396944293#endif
4397044294
4397144295#ifdef __LITTLE_ENDIAN__
43972__ai uint16x8_t vcaleq_f16(float16x8_t __p0, float16x8_t __p1) {
43973 uint16x8_t __ret;
43974 __ret = (uint16x8_t) __builtin_neon_vcaleq_v((int8x16_t)__p0, (int8x16_t)__p1, 49);
43975 return __ret;
43976}
44296#define vcopyq_lane_f32(__p0_271, __p1_271, __p2_271, __p3_271) __extension__ ({ \
44297 float32x4_t __ret_271; \
44298 float32x4_t __s0_271 = __p0_271; \
44299 float32x2_t __s2_271 = __p2_271; \
44300 __ret_271 = vsetq_lane_f32(vget_lane_f32(__s2_271, __p3_271), __s0_271, __p1_271); \
44301 __ret_271; \
44302})
4397744303#else
43978__ai uint16x8_t vcaleq_f16(float16x8_t __p0, float16x8_t __p1) {
43979 uint16x8_t __ret;
43980 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
43981 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
43982 __ret = (uint16x8_t) __builtin_neon_vcaleq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 49);
43983 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
43984 return __ret;
43985}
44304#define vcopyq_lane_f32(__p0_272, __p1_272, __p2_272, __p3_272) __extension__ ({ \
44305 float32x4_t __ret_272; \
44306 float32x4_t __s0_272 = __p0_272; \
44307 float32x2_t __s2_272 = __p2_272; \
44308 float32x4_t __rev0_272; __rev0_272 = __builtin_shufflevector(__s0_272, __s0_272, 3, 2, 1, 0); \
44309 float32x2_t __rev2_272; __rev2_272 = __builtin_shufflevector(__s2_272, __s2_272, 1, 0); \
44310 __ret_272 = __noswap_vsetq_lane_f32(__noswap_vget_lane_f32(__rev2_272, __p3_272), __rev0_272, __p1_272); \
44311 __ret_272 = __builtin_shufflevector(__ret_272, __ret_272, 3, 2, 1, 0); \
44312 __ret_272; \
44313})
4398644314#endif
4398744315
4398844316#ifdef __LITTLE_ENDIAN__
43989__ai uint16x4_t vcale_f16(float16x4_t __p0, float16x4_t __p1) {
43990 uint16x4_t __ret;
43991 __ret = (uint16x4_t) __builtin_neon_vcale_v((int8x8_t)__p0, (int8x8_t)__p1, 17);
43992 return __ret;
43993}
44317#define vcopyq_lane_s32(__p0_273, __p1_273, __p2_273, __p3_273) __extension__ ({ \
44318 int32x4_t __ret_273; \
44319 int32x4_t __s0_273 = __p0_273; \
44320 int32x2_t __s2_273 = __p2_273; \
44321 __ret_273 = vsetq_lane_s32(vget_lane_s32(__s2_273, __p3_273), __s0_273, __p1_273); \
44322 __ret_273; \
44323})
4399444324#else
43995__ai uint16x4_t vcale_f16(float16x4_t __p0, float16x4_t __p1) {
43996 uint16x4_t __ret;
43997 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
43998 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
43999 __ret = (uint16x4_t) __builtin_neon_vcale_v((int8x8_t)__rev0, (int8x8_t)__rev1, 17);
44000 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
44001 return __ret;
44002}
44325#define vcopyq_lane_s32(__p0_274, __p1_274, __p2_274, __p3_274) __extension__ ({ \
44326 int32x4_t __ret_274; \
44327 int32x4_t __s0_274 = __p0_274; \
44328 int32x2_t __s2_274 = __p2_274; \
44329 int32x4_t __rev0_274; __rev0_274 = __builtin_shufflevector(__s0_274, __s0_274, 3, 2, 1, 0); \
44330 int32x2_t __rev2_274; __rev2_274 = __builtin_shufflevector(__s2_274, __s2_274, 1, 0); \
44331 __ret_274 = __noswap_vsetq_lane_s32(__noswap_vget_lane_s32(__rev2_274, __p3_274), __rev0_274, __p1_274); \
44332 __ret_274 = __builtin_shufflevector(__ret_274, __ret_274, 3, 2, 1, 0); \
44333 __ret_274; \
44334})
4400344335#endif
4400444336
4400544337#ifdef __LITTLE_ENDIAN__
44006__ai uint16x8_t vcaltq_f16(float16x8_t __p0, float16x8_t __p1) {
44007 uint16x8_t __ret;
44008 __ret = (uint16x8_t) __builtin_neon_vcaltq_v((int8x16_t)__p0, (int8x16_t)__p1, 49);
44009 return __ret;
44010}
44338#define vcopyq_lane_s64(__p0_275, __p1_275, __p2_275, __p3_275) __extension__ ({ \
44339 int64x2_t __ret_275; \
44340 int64x2_t __s0_275 = __p0_275; \
44341 int64x1_t __s2_275 = __p2_275; \
44342 __ret_275 = vsetq_lane_s64(vget_lane_s64(__s2_275, __p3_275), __s0_275, __p1_275); \
44343 __ret_275; \
44344})
4401144345#else
44012__ai uint16x8_t vcaltq_f16(float16x8_t __p0, float16x8_t __p1) {
44013 uint16x8_t __ret;
44014 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
44015 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
44016 __ret = (uint16x8_t) __builtin_neon_vcaltq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 49);
44017 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
44018 return __ret;
44019}
44346#define vcopyq_lane_s64(__p0_276, __p1_276, __p2_276, __p3_276) __extension__ ({ \
44347 int64x2_t __ret_276; \
44348 int64x2_t __s0_276 = __p0_276; \
44349 int64x1_t __s2_276 = __p2_276; \
44350 int64x2_t __rev0_276; __rev0_276 = __builtin_shufflevector(__s0_276, __s0_276, 1, 0); \
44351 __ret_276 = __noswap_vsetq_lane_s64(vget_lane_s64(__s2_276, __p3_276), __rev0_276, __p1_276); \
44352 __ret_276 = __builtin_shufflevector(__ret_276, __ret_276, 1, 0); \
44353 __ret_276; \
44354})
4402044355#endif
4402144356
4402244357#ifdef __LITTLE_ENDIAN__
44023__ai uint16x4_t vcalt_f16(float16x4_t __p0, float16x4_t __p1) {
44024 uint16x4_t __ret;
44025 __ret = (uint16x4_t) __builtin_neon_vcalt_v((int8x8_t)__p0, (int8x8_t)__p1, 17);
44026 return __ret;
44027}
44358#define vcopyq_lane_s16(__p0_277, __p1_277, __p2_277, __p3_277) __extension__ ({ \
44359 int16x8_t __ret_277; \
44360 int16x8_t __s0_277 = __p0_277; \
44361 int16x4_t __s2_277 = __p2_277; \
44362 __ret_277 = vsetq_lane_s16(vget_lane_s16(__s2_277, __p3_277), __s0_277, __p1_277); \
44363 __ret_277; \
44364})
4402844365#else
44029__ai uint16x4_t vcalt_f16(float16x4_t __p0, float16x4_t __p1) {
44030 uint16x4_t __ret;
44031 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
44032 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
44033 __ret = (uint16x4_t) __builtin_neon_vcalt_v((int8x8_t)__rev0, (int8x8_t)__rev1, 17);
44034 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
44035 return __ret;
44036}
44366#define vcopyq_lane_s16(__p0_278, __p1_278, __p2_278, __p3_278) __extension__ ({ \
44367 int16x8_t __ret_278; \
44368 int16x8_t __s0_278 = __p0_278; \
44369 int16x4_t __s2_278 = __p2_278; \
44370 int16x8_t __rev0_278; __rev0_278 = __builtin_shufflevector(__s0_278, __s0_278, 7, 6, 5, 4, 3, 2, 1, 0); \
44371 int16x4_t __rev2_278; __rev2_278 = __builtin_shufflevector(__s2_278, __s2_278, 3, 2, 1, 0); \
44372 __ret_278 = __noswap_vsetq_lane_s16(__noswap_vget_lane_s16(__rev2_278, __p3_278), __rev0_278, __p1_278); \
44373 __ret_278 = __builtin_shufflevector(__ret_278, __ret_278, 7, 6, 5, 4, 3, 2, 1, 0); \
44374 __ret_278; \
44375})
4403744376#endif
4403844377
4403944378#ifdef __LITTLE_ENDIAN__
44040__ai uint16x8_t vceqq_f16(float16x8_t __p0, float16x8_t __p1) {
44041 uint16x8_t __ret;
44042 __ret = (uint16x8_t)(__p0 == __p1);
44043 return __ret;
44044}
44379#define vcopy_lane_p8(__p0_279, __p1_279, __p2_279, __p3_279) __extension__ ({ \
44380 poly8x8_t __ret_279; \
44381 poly8x8_t __s0_279 = __p0_279; \
44382 poly8x8_t __s2_279 = __p2_279; \
44383 __ret_279 = vset_lane_p8(vget_lane_p8(__s2_279, __p3_279), __s0_279, __p1_279); \
44384 __ret_279; \
44385})
4404544386#else
44046__ai uint16x8_t vceqq_f16(float16x8_t __p0, float16x8_t __p1) {
44047 uint16x8_t __ret;
44048 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
44049 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
44050 __ret = (uint16x8_t)(__rev0 == __rev1);
44051 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
44052 return __ret;
44053}
44387#define vcopy_lane_p8(__p0_280, __p1_280, __p2_280, __p3_280) __extension__ ({ \
44388 poly8x8_t __ret_280; \
44389 poly8x8_t __s0_280 = __p0_280; \
44390 poly8x8_t __s2_280 = __p2_280; \
44391 poly8x8_t __rev0_280; __rev0_280 = __builtin_shufflevector(__s0_280, __s0_280, 7, 6, 5, 4, 3, 2, 1, 0); \
44392 poly8x8_t __rev2_280; __rev2_280 = __builtin_shufflevector(__s2_280, __s2_280, 7, 6, 5, 4, 3, 2, 1, 0); \
44393 __ret_280 = __noswap_vset_lane_p8(__noswap_vget_lane_p8(__rev2_280, __p3_280), __rev0_280, __p1_280); \
44394 __ret_280 = __builtin_shufflevector(__ret_280, __ret_280, 7, 6, 5, 4, 3, 2, 1, 0); \
44395 __ret_280; \
44396})
4405444397#endif
4405544398
4405644399#ifdef __LITTLE_ENDIAN__
44057__ai uint16x4_t vceq_f16(float16x4_t __p0, float16x4_t __p1) {
44058 uint16x4_t __ret;
44059 __ret = (uint16x4_t)(__p0 == __p1);
44060 return __ret;
44061}
44400#define vcopy_lane_p16(__p0_281, __p1_281, __p2_281, __p3_281) __extension__ ({ \
44401 poly16x4_t __ret_281; \
44402 poly16x4_t __s0_281 = __p0_281; \
44403 poly16x4_t __s2_281 = __p2_281; \
44404 __ret_281 = vset_lane_p16(vget_lane_p16(__s2_281, __p3_281), __s0_281, __p1_281); \
44405 __ret_281; \
44406})
4406244407#else
44063__ai uint16x4_t vceq_f16(float16x4_t __p0, float16x4_t __p1) {
44064 uint16x4_t __ret;
44065 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
44066 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
44067 __ret = (uint16x4_t)(__rev0 == __rev1);
44068 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
44069 return __ret;
44070}
44408#define vcopy_lane_p16(__p0_282, __p1_282, __p2_282, __p3_282) __extension__ ({ \
44409 poly16x4_t __ret_282; \
44410 poly16x4_t __s0_282 = __p0_282; \
44411 poly16x4_t __s2_282 = __p2_282; \
44412 poly16x4_t __rev0_282; __rev0_282 = __builtin_shufflevector(__s0_282, __s0_282, 3, 2, 1, 0); \
44413 poly16x4_t __rev2_282; __rev2_282 = __builtin_shufflevector(__s2_282, __s2_282, 3, 2, 1, 0); \
44414 __ret_282 = __noswap_vset_lane_p16(__noswap_vget_lane_p16(__rev2_282, __p3_282), __rev0_282, __p1_282); \
44415 __ret_282 = __builtin_shufflevector(__ret_282, __ret_282, 3, 2, 1, 0); \
44416 __ret_282; \
44417})
4407144418#endif
4407244419
4407344420#ifdef __LITTLE_ENDIAN__
44074__ai uint16x8_t vceqzq_f16(float16x8_t __p0) {
44075 uint16x8_t __ret;
44076 __ret = (uint16x8_t) __builtin_neon_vceqzq_v((int8x16_t)__p0, 49);
44077 return __ret;
44078}
44421#define vcopy_lane_u8(__p0_283, __p1_283, __p2_283, __p3_283) __extension__ ({ \
44422 uint8x8_t __ret_283; \
44423 uint8x8_t __s0_283 = __p0_283; \
44424 uint8x8_t __s2_283 = __p2_283; \
44425 __ret_283 = vset_lane_u8(vget_lane_u8(__s2_283, __p3_283), __s0_283, __p1_283); \
44426 __ret_283; \
44427})
4407944428#else
44080__ai uint16x8_t vceqzq_f16(float16x8_t __p0) {
44081 uint16x8_t __ret;
44082 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
44083 __ret = (uint16x8_t) __builtin_neon_vceqzq_v((int8x16_t)__rev0, 49);
44084 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
44085 return __ret;
44086}
44429#define vcopy_lane_u8(__p0_284, __p1_284, __p2_284, __p3_284) __extension__ ({ \
44430 uint8x8_t __ret_284; \
44431 uint8x8_t __s0_284 = __p0_284; \
44432 uint8x8_t __s2_284 = __p2_284; \
44433 uint8x8_t __rev0_284; __rev0_284 = __builtin_shufflevector(__s0_284, __s0_284, 7, 6, 5, 4, 3, 2, 1, 0); \
44434 uint8x8_t __rev2_284; __rev2_284 = __builtin_shufflevector(__s2_284, __s2_284, 7, 6, 5, 4, 3, 2, 1, 0); \
44435 __ret_284 = __noswap_vset_lane_u8(__noswap_vget_lane_u8(__rev2_284, __p3_284), __rev0_284, __p1_284); \
44436 __ret_284 = __builtin_shufflevector(__ret_284, __ret_284, 7, 6, 5, 4, 3, 2, 1, 0); \
44437 __ret_284; \
44438})
4408744439#endif
4408844440
4408944441#ifdef __LITTLE_ENDIAN__
44090__ai uint16x4_t vceqz_f16(float16x4_t __p0) {
44091 uint16x4_t __ret;
44092 __ret = (uint16x4_t) __builtin_neon_vceqz_v((int8x8_t)__p0, 17);
44093 return __ret;
44094}
44442#define vcopy_lane_u32(__p0_285, __p1_285, __p2_285, __p3_285) __extension__ ({ \
44443 uint32x2_t __ret_285; \
44444 uint32x2_t __s0_285 = __p0_285; \
44445 uint32x2_t __s2_285 = __p2_285; \
44446 __ret_285 = vset_lane_u32(vget_lane_u32(__s2_285, __p3_285), __s0_285, __p1_285); \
44447 __ret_285; \
44448})
4409544449#else
44096__ai uint16x4_t vceqz_f16(float16x4_t __p0) {
44097 uint16x4_t __ret;
44098 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
44099 __ret = (uint16x4_t) __builtin_neon_vceqz_v((int8x8_t)__rev0, 17);
44100 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
44101 return __ret;
44102}
44450#define vcopy_lane_u32(__p0_286, __p1_286, __p2_286, __p3_286) __extension__ ({ \
44451 uint32x2_t __ret_286; \
44452 uint32x2_t __s0_286 = __p0_286; \
44453 uint32x2_t __s2_286 = __p2_286; \
44454 uint32x2_t __rev0_286; __rev0_286 = __builtin_shufflevector(__s0_286, __s0_286, 1, 0); \
44455 uint32x2_t __rev2_286; __rev2_286 = __builtin_shufflevector(__s2_286, __s2_286, 1, 0); \
44456 __ret_286 = __noswap_vset_lane_u32(__noswap_vget_lane_u32(__rev2_286, __p3_286), __rev0_286, __p1_286); \
44457 __ret_286 = __builtin_shufflevector(__ret_286, __ret_286, 1, 0); \
44458 __ret_286; \
44459})
4410344460#endif
4410444461
44462#define vcopy_lane_u64(__p0_287, __p1_287, __p2_287, __p3_287) __extension__ ({ \
44463 uint64x1_t __ret_287; \
44464 uint64x1_t __s0_287 = __p0_287; \
44465 uint64x1_t __s2_287 = __p2_287; \
44466 __ret_287 = vset_lane_u64(vget_lane_u64(__s2_287, __p3_287), __s0_287, __p1_287); \
44467 __ret_287; \
44468})
4410544469#ifdef __LITTLE_ENDIAN__
44106__ai uint16x8_t vcgeq_f16(float16x8_t __p0, float16x8_t __p1) {
44107 uint16x8_t __ret;
44108 __ret = (uint16x8_t)(__p0 >= __p1);
44109 return __ret;
44110}
44470#define vcopy_lane_u16(__p0_288, __p1_288, __p2_288, __p3_288) __extension__ ({ \
44471 uint16x4_t __ret_288; \
44472 uint16x4_t __s0_288 = __p0_288; \
44473 uint16x4_t __s2_288 = __p2_288; \
44474 __ret_288 = vset_lane_u16(vget_lane_u16(__s2_288, __p3_288), __s0_288, __p1_288); \
44475 __ret_288; \
44476})
4411144477#else
44112__ai uint16x8_t vcgeq_f16(float16x8_t __p0, float16x8_t __p1) {
44113 uint16x8_t __ret;
44114 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
44115 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
44116 __ret = (uint16x8_t)(__rev0 >= __rev1);
44117 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
44118 return __ret;
44119}
44478#define vcopy_lane_u16(__p0_289, __p1_289, __p2_289, __p3_289) __extension__ ({ \
44479 uint16x4_t __ret_289; \
44480 uint16x4_t __s0_289 = __p0_289; \
44481 uint16x4_t __s2_289 = __p2_289; \
44482 uint16x4_t __rev0_289; __rev0_289 = __builtin_shufflevector(__s0_289, __s0_289, 3, 2, 1, 0); \
44483 uint16x4_t __rev2_289; __rev2_289 = __builtin_shufflevector(__s2_289, __s2_289, 3, 2, 1, 0); \
44484 __ret_289 = __noswap_vset_lane_u16(__noswap_vget_lane_u16(__rev2_289, __p3_289), __rev0_289, __p1_289); \
44485 __ret_289 = __builtin_shufflevector(__ret_289, __ret_289, 3, 2, 1, 0); \
44486 __ret_289; \
44487})
4412044488#endif
4412144489
4412244490#ifdef __LITTLE_ENDIAN__
44123__ai uint16x4_t vcge_f16(float16x4_t __p0, float16x4_t __p1) {
44124 uint16x4_t __ret;
44125 __ret = (uint16x4_t)(__p0 >= __p1);
44126 return __ret;
44127}
44491#define vcopy_lane_s8(__p0_290, __p1_290, __p2_290, __p3_290) __extension__ ({ \
44492 int8x8_t __ret_290; \
44493 int8x8_t __s0_290 = __p0_290; \
44494 int8x8_t __s2_290 = __p2_290; \
44495 __ret_290 = vset_lane_s8(vget_lane_s8(__s2_290, __p3_290), __s0_290, __p1_290); \
44496 __ret_290; \
44497})
4412844498#else
44129__ai uint16x4_t vcge_f16(float16x4_t __p0, float16x4_t __p1) {
44130 uint16x4_t __ret;
44131 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
44132 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
44133 __ret = (uint16x4_t)(__rev0 >= __rev1);
44134 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
44135 return __ret;
44136}
44499#define vcopy_lane_s8(__p0_291, __p1_291, __p2_291, __p3_291) __extension__ ({ \
44500 int8x8_t __ret_291; \
44501 int8x8_t __s0_291 = __p0_291; \
44502 int8x8_t __s2_291 = __p2_291; \
44503 int8x8_t __rev0_291; __rev0_291 = __builtin_shufflevector(__s0_291, __s0_291, 7, 6, 5, 4, 3, 2, 1, 0); \
44504 int8x8_t __rev2_291; __rev2_291 = __builtin_shufflevector(__s2_291, __s2_291, 7, 6, 5, 4, 3, 2, 1, 0); \
44505 __ret_291 = __noswap_vset_lane_s8(__noswap_vget_lane_s8(__rev2_291, __p3_291), __rev0_291, __p1_291); \
44506 __ret_291 = __builtin_shufflevector(__ret_291, __ret_291, 7, 6, 5, 4, 3, 2, 1, 0); \
44507 __ret_291; \
44508})
4413744509#endif
4413844510
4413944511#ifdef __LITTLE_ENDIAN__
44140__ai uint16x8_t vcgezq_f16(float16x8_t __p0) {
44141 uint16x8_t __ret;
44142 __ret = (uint16x8_t) __builtin_neon_vcgezq_v((int8x16_t)__p0, 49);
44143 return __ret;
44144}
44512#define vcopy_lane_f32(__p0_292, __p1_292, __p2_292, __p3_292) __extension__ ({ \
44513 float32x2_t __ret_292; \
44514 float32x2_t __s0_292 = __p0_292; \
44515 float32x2_t __s2_292 = __p2_292; \
44516 __ret_292 = vset_lane_f32(vget_lane_f32(__s2_292, __p3_292), __s0_292, __p1_292); \
44517 __ret_292; \
44518})
4414544519#else
44146__ai uint16x8_t vcgezq_f16(float16x8_t __p0) {
44147 uint16x8_t __ret;
44148 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
44149 __ret = (uint16x8_t) __builtin_neon_vcgezq_v((int8x16_t)__rev0, 49);
44150 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
44151 return __ret;
44152}
44520#define vcopy_lane_f32(__p0_293, __p1_293, __p2_293, __p3_293) __extension__ ({ \
44521 float32x2_t __ret_293; \
44522 float32x2_t __s0_293 = __p0_293; \
44523 float32x2_t __s2_293 = __p2_293; \
44524 float32x2_t __rev0_293; __rev0_293 = __builtin_shufflevector(__s0_293, __s0_293, 1, 0); \
44525 float32x2_t __rev2_293; __rev2_293 = __builtin_shufflevector(__s2_293, __s2_293, 1, 0); \
44526 __ret_293 = __noswap_vset_lane_f32(__noswap_vget_lane_f32(__rev2_293, __p3_293), __rev0_293, __p1_293); \
44527 __ret_293 = __builtin_shufflevector(__ret_293, __ret_293, 1, 0); \
44528 __ret_293; \
44529})
4415344530#endif
4415444531
4415544532#ifdef __LITTLE_ENDIAN__
44156__ai uint16x4_t vcgez_f16(float16x4_t __p0) {
44157 uint16x4_t __ret;
44158 __ret = (uint16x4_t) __builtin_neon_vcgez_v((int8x8_t)__p0, 17);
44159 return __ret;
44160}
44533#define vcopy_lane_s32(__p0_294, __p1_294, __p2_294, __p3_294) __extension__ ({ \
44534 int32x2_t __ret_294; \
44535 int32x2_t __s0_294 = __p0_294; \
44536 int32x2_t __s2_294 = __p2_294; \
44537 __ret_294 = vset_lane_s32(vget_lane_s32(__s2_294, __p3_294), __s0_294, __p1_294); \
44538 __ret_294; \
44539})
4416144540#else
44162__ai uint16x4_t vcgez_f16(float16x4_t __p0) {
44163 uint16x4_t __ret;
44164 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
44165 __ret = (uint16x4_t) __builtin_neon_vcgez_v((int8x8_t)__rev0, 17);
44166 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
44167 return __ret;
44168}
44541#define vcopy_lane_s32(__p0_295, __p1_295, __p2_295, __p3_295) __extension__ ({ \
44542 int32x2_t __ret_295; \
44543 int32x2_t __s0_295 = __p0_295; \
44544 int32x2_t __s2_295 = __p2_295; \
44545 int32x2_t __rev0_295; __rev0_295 = __builtin_shufflevector(__s0_295, __s0_295, 1, 0); \
44546 int32x2_t __rev2_295; __rev2_295 = __builtin_shufflevector(__s2_295, __s2_295, 1, 0); \
44547 __ret_295 = __noswap_vset_lane_s32(__noswap_vget_lane_s32(__rev2_295, __p3_295), __rev0_295, __p1_295); \
44548 __ret_295 = __builtin_shufflevector(__ret_295, __ret_295, 1, 0); \
44549 __ret_295; \
44550})
4416944551#endif
4417044552
44553#define vcopy_lane_s64(__p0_296, __p1_296, __p2_296, __p3_296) __extension__ ({ \
44554 int64x1_t __ret_296; \
44555 int64x1_t __s0_296 = __p0_296; \
44556 int64x1_t __s2_296 = __p2_296; \
44557 __ret_296 = vset_lane_s64(vget_lane_s64(__s2_296, __p3_296), __s0_296, __p1_296); \
44558 __ret_296; \
44559})
4417144560#ifdef __LITTLE_ENDIAN__
44172__ai uint16x8_t vcgtq_f16(float16x8_t __p0, float16x8_t __p1) {
44173 uint16x8_t __ret;
44174 __ret = (uint16x8_t)(__p0 > __p1);
44175 return __ret;
44176}
44561#define vcopy_lane_s16(__p0_297, __p1_297, __p2_297, __p3_297) __extension__ ({ \
44562 int16x4_t __ret_297; \
44563 int16x4_t __s0_297 = __p0_297; \
44564 int16x4_t __s2_297 = __p2_297; \
44565 __ret_297 = vset_lane_s16(vget_lane_s16(__s2_297, __p3_297), __s0_297, __p1_297); \
44566 __ret_297; \
44567})
4417744568#else
44178__ai uint16x8_t vcgtq_f16(float16x8_t __p0, float16x8_t __p1) {
44179 uint16x8_t __ret;
44180 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
44181 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
44182 __ret = (uint16x8_t)(__rev0 > __rev1);
44183 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
44184 return __ret;
44185}
44569#define vcopy_lane_s16(__p0_298, __p1_298, __p2_298, __p3_298) __extension__ ({ \
44570 int16x4_t __ret_298; \
44571 int16x4_t __s0_298 = __p0_298; \
44572 int16x4_t __s2_298 = __p2_298; \
44573 int16x4_t __rev0_298; __rev0_298 = __builtin_shufflevector(__s0_298, __s0_298, 3, 2, 1, 0); \
44574 int16x4_t __rev2_298; __rev2_298 = __builtin_shufflevector(__s2_298, __s2_298, 3, 2, 1, 0); \
44575 __ret_298 = __noswap_vset_lane_s16(__noswap_vget_lane_s16(__rev2_298, __p3_298), __rev0_298, __p1_298); \
44576 __ret_298 = __builtin_shufflevector(__ret_298, __ret_298, 3, 2, 1, 0); \
44577 __ret_298; \
44578})
4418644579#endif
4418744580
4418844581#ifdef __LITTLE_ENDIAN__
44189__ai uint16x4_t vcgt_f16(float16x4_t __p0, float16x4_t __p1) {
44190 uint16x4_t __ret;
44191 __ret = (uint16x4_t)(__p0 > __p1);
44192 return __ret;
44193}
44582#define vcopyq_laneq_p8(__p0_299, __p1_299, __p2_299, __p3_299) __extension__ ({ \
44583 poly8x16_t __ret_299; \
44584 poly8x16_t __s0_299 = __p0_299; \
44585 poly8x16_t __s2_299 = __p2_299; \
44586 __ret_299 = vsetq_lane_p8(vgetq_lane_p8(__s2_299, __p3_299), __s0_299, __p1_299); \
44587 __ret_299; \
44588})
4419444589#else
44195__ai uint16x4_t vcgt_f16(float16x4_t __p0, float16x4_t __p1) {
44196 uint16x4_t __ret;
44197 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
44198 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
44199 __ret = (uint16x4_t)(__rev0 > __rev1);
44200 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
44201 return __ret;
44202}
44590#define vcopyq_laneq_p8(__p0_300, __p1_300, __p2_300, __p3_300) __extension__ ({ \
44591 poly8x16_t __ret_300; \
44592 poly8x16_t __s0_300 = __p0_300; \
44593 poly8x16_t __s2_300 = __p2_300; \
44594 poly8x16_t __rev0_300; __rev0_300 = __builtin_shufflevector(__s0_300, __s0_300, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
44595 poly8x16_t __rev2_300; __rev2_300 = __builtin_shufflevector(__s2_300, __s2_300, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
44596 __ret_300 = __noswap_vsetq_lane_p8(__noswap_vgetq_lane_p8(__rev2_300, __p3_300), __rev0_300, __p1_300); \
44597 __ret_300 = __builtin_shufflevector(__ret_300, __ret_300, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
44598 __ret_300; \
44599})
4420344600#endif
4420444601
4420544602#ifdef __LITTLE_ENDIAN__
44206__ai uint16x8_t vcgtzq_f16(float16x8_t __p0) {
44207 uint16x8_t __ret;
44208 __ret = (uint16x8_t) __builtin_neon_vcgtzq_v((int8x16_t)__p0, 49);
44209 return __ret;
44210}
44603#define vcopyq_laneq_p16(__p0_301, __p1_301, __p2_301, __p3_301) __extension__ ({ \
44604 poly16x8_t __ret_301; \
44605 poly16x8_t __s0_301 = __p0_301; \
44606 poly16x8_t __s2_301 = __p2_301; \
44607 __ret_301 = vsetq_lane_p16(vgetq_lane_p16(__s2_301, __p3_301), __s0_301, __p1_301); \
44608 __ret_301; \
44609})
4421144610#else
44212__ai uint16x8_t vcgtzq_f16(float16x8_t __p0) {
44213 uint16x8_t __ret;
44214 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
44215 __ret = (uint16x8_t) __builtin_neon_vcgtzq_v((int8x16_t)__rev0, 49);
44216 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
44217 return __ret;
44218}
44611#define vcopyq_laneq_p16(__p0_302, __p1_302, __p2_302, __p3_302) __extension__ ({ \
44612 poly16x8_t __ret_302; \
44613 poly16x8_t __s0_302 = __p0_302; \
44614 poly16x8_t __s2_302 = __p2_302; \
44615 poly16x8_t __rev0_302; __rev0_302 = __builtin_shufflevector(__s0_302, __s0_302, 7, 6, 5, 4, 3, 2, 1, 0); \
44616 poly16x8_t __rev2_302; __rev2_302 = __builtin_shufflevector(__s2_302, __s2_302, 7, 6, 5, 4, 3, 2, 1, 0); \
44617 __ret_302 = __noswap_vsetq_lane_p16(__noswap_vgetq_lane_p16(__rev2_302, __p3_302), __rev0_302, __p1_302); \
44618 __ret_302 = __builtin_shufflevector(__ret_302, __ret_302, 7, 6, 5, 4, 3, 2, 1, 0); \
44619 __ret_302; \
44620})
4421944621#endif
4422044622
4422144623#ifdef __LITTLE_ENDIAN__
44222__ai uint16x4_t vcgtz_f16(float16x4_t __p0) {
44223 uint16x4_t __ret;
44224 __ret = (uint16x4_t) __builtin_neon_vcgtz_v((int8x8_t)__p0, 17);
44225 return __ret;
44226}
44624#define vcopyq_laneq_u8(__p0_303, __p1_303, __p2_303, __p3_303) __extension__ ({ \
44625 uint8x16_t __ret_303; \
44626 uint8x16_t __s0_303 = __p0_303; \
44627 uint8x16_t __s2_303 = __p2_303; \
44628 __ret_303 = vsetq_lane_u8(vgetq_lane_u8(__s2_303, __p3_303), __s0_303, __p1_303); \
44629 __ret_303; \
44630})
4422744631#else
44228__ai uint16x4_t vcgtz_f16(float16x4_t __p0) {
44229 uint16x4_t __ret;
44230 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
44231 __ret = (uint16x4_t) __builtin_neon_vcgtz_v((int8x8_t)__rev0, 17);
44232 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
44233 return __ret;
44234}
44632#define vcopyq_laneq_u8(__p0_304, __p1_304, __p2_304, __p3_304) __extension__ ({ \
44633 uint8x16_t __ret_304; \
44634 uint8x16_t __s0_304 = __p0_304; \
44635 uint8x16_t __s2_304 = __p2_304; \
44636 uint8x16_t __rev0_304; __rev0_304 = __builtin_shufflevector(__s0_304, __s0_304, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
44637 uint8x16_t __rev2_304; __rev2_304 = __builtin_shufflevector(__s2_304, __s2_304, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
44638 __ret_304 = __noswap_vsetq_lane_u8(__noswap_vgetq_lane_u8(__rev2_304, __p3_304), __rev0_304, __p1_304); \
44639 __ret_304 = __builtin_shufflevector(__ret_304, __ret_304, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
44640 __ret_304; \
44641})
4423544642#endif
4423644643
4423744644#ifdef __LITTLE_ENDIAN__
44238__ai uint16x8_t vcleq_f16(float16x8_t __p0, float16x8_t __p1) {
44239 uint16x8_t __ret;
44240 __ret = (uint16x8_t)(__p0 <= __p1);
44241 return __ret;
44242}
44645#define vcopyq_laneq_u32(__p0_305, __p1_305, __p2_305, __p3_305) __extension__ ({ \
44646 uint32x4_t __ret_305; \
44647 uint32x4_t __s0_305 = __p0_305; \
44648 uint32x4_t __s2_305 = __p2_305; \
44649 __ret_305 = vsetq_lane_u32(vgetq_lane_u32(__s2_305, __p3_305), __s0_305, __p1_305); \
44650 __ret_305; \
44651})
4424344652#else
44244__ai uint16x8_t vcleq_f16(float16x8_t __p0, float16x8_t __p1) {
44245 uint16x8_t __ret;
44246 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
44247 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
44248 __ret = (uint16x8_t)(__rev0 <= __rev1);
44249 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
44250 return __ret;
44251}
44653#define vcopyq_laneq_u32(__p0_306, __p1_306, __p2_306, __p3_306) __extension__ ({ \
44654 uint32x4_t __ret_306; \
44655 uint32x4_t __s0_306 = __p0_306; \
44656 uint32x4_t __s2_306 = __p2_306; \
44657 uint32x4_t __rev0_306; __rev0_306 = __builtin_shufflevector(__s0_306, __s0_306, 3, 2, 1, 0); \
44658 uint32x4_t __rev2_306; __rev2_306 = __builtin_shufflevector(__s2_306, __s2_306, 3, 2, 1, 0); \
44659 __ret_306 = __noswap_vsetq_lane_u32(__noswap_vgetq_lane_u32(__rev2_306, __p3_306), __rev0_306, __p1_306); \
44660 __ret_306 = __builtin_shufflevector(__ret_306, __ret_306, 3, 2, 1, 0); \
44661 __ret_306; \
44662})
4425244663#endif
4425344664
4425444665#ifdef __LITTLE_ENDIAN__
44255__ai uint16x4_t vcle_f16(float16x4_t __p0, float16x4_t __p1) {
44256 uint16x4_t __ret;
44257 __ret = (uint16x4_t)(__p0 <= __p1);
44258 return __ret;
44259}
44666#define vcopyq_laneq_u64(__p0_307, __p1_307, __p2_307, __p3_307) __extension__ ({ \
44667 uint64x2_t __ret_307; \
44668 uint64x2_t __s0_307 = __p0_307; \
44669 uint64x2_t __s2_307 = __p2_307; \
44670 __ret_307 = vsetq_lane_u64(vgetq_lane_u64(__s2_307, __p3_307), __s0_307, __p1_307); \
44671 __ret_307; \
44672})
4426044673#else
44261__ai uint16x4_t vcle_f16(float16x4_t __p0, float16x4_t __p1) {
44262 uint16x4_t __ret;
44263 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
44264 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
44265 __ret = (uint16x4_t)(__rev0 <= __rev1);
44266 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
44267 return __ret;
44268}
44674#define vcopyq_laneq_u64(__p0_308, __p1_308, __p2_308, __p3_308) __extension__ ({ \
44675 uint64x2_t __ret_308; \
44676 uint64x2_t __s0_308 = __p0_308; \
44677 uint64x2_t __s2_308 = __p2_308; \
44678 uint64x2_t __rev0_308; __rev0_308 = __builtin_shufflevector(__s0_308, __s0_308, 1, 0); \
44679 uint64x2_t __rev2_308; __rev2_308 = __builtin_shufflevector(__s2_308, __s2_308, 1, 0); \
44680 __ret_308 = __noswap_vsetq_lane_u64(__noswap_vgetq_lane_u64(__rev2_308, __p3_308), __rev0_308, __p1_308); \
44681 __ret_308 = __builtin_shufflevector(__ret_308, __ret_308, 1, 0); \
44682 __ret_308; \
44683})
4426944684#endif
4427044685
4427144686#ifdef __LITTLE_ENDIAN__
44272__ai uint16x8_t vclezq_f16(float16x8_t __p0) {
44273 uint16x8_t __ret;
44274 __ret = (uint16x8_t) __builtin_neon_vclezq_v((int8x16_t)__p0, 49);
44275 return __ret;
44276}
44687#define vcopyq_laneq_u16(__p0_309, __p1_309, __p2_309, __p3_309) __extension__ ({ \
44688 uint16x8_t __ret_309; \
44689 uint16x8_t __s0_309 = __p0_309; \
44690 uint16x8_t __s2_309 = __p2_309; \
44691 __ret_309 = vsetq_lane_u16(vgetq_lane_u16(__s2_309, __p3_309), __s0_309, __p1_309); \
44692 __ret_309; \
44693})
4427744694#else
44278__ai uint16x8_t vclezq_f16(float16x8_t __p0) {
44279 uint16x8_t __ret;
44280 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
44281 __ret = (uint16x8_t) __builtin_neon_vclezq_v((int8x16_t)__rev0, 49);
44282 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
44283 return __ret;
44284}
44695#define vcopyq_laneq_u16(__p0_310, __p1_310, __p2_310, __p3_310) __extension__ ({ \
44696 uint16x8_t __ret_310; \
44697 uint16x8_t __s0_310 = __p0_310; \
44698 uint16x8_t __s2_310 = __p2_310; \
44699 uint16x8_t __rev0_310; __rev0_310 = __builtin_shufflevector(__s0_310, __s0_310, 7, 6, 5, 4, 3, 2, 1, 0); \
44700 uint16x8_t __rev2_310; __rev2_310 = __builtin_shufflevector(__s2_310, __s2_310, 7, 6, 5, 4, 3, 2, 1, 0); \
44701 __ret_310 = __noswap_vsetq_lane_u16(__noswap_vgetq_lane_u16(__rev2_310, __p3_310), __rev0_310, __p1_310); \
44702 __ret_310 = __builtin_shufflevector(__ret_310, __ret_310, 7, 6, 5, 4, 3, 2, 1, 0); \
44703 __ret_310; \
44704})
4428544705#endif
4428644706
4428744707#ifdef __LITTLE_ENDIAN__
44288__ai uint16x4_t vclez_f16(float16x4_t __p0) {
44289 uint16x4_t __ret;
44290 __ret = (uint16x4_t) __builtin_neon_vclez_v((int8x8_t)__p0, 17);
44291 return __ret;
44292}
44708#define vcopyq_laneq_s8(__p0_311, __p1_311, __p2_311, __p3_311) __extension__ ({ \
44709 int8x16_t __ret_311; \
44710 int8x16_t __s0_311 = __p0_311; \
44711 int8x16_t __s2_311 = __p2_311; \
44712 __ret_311 = vsetq_lane_s8(vgetq_lane_s8(__s2_311, __p3_311), __s0_311, __p1_311); \
44713 __ret_311; \
44714})
4429344715#else
44294__ai uint16x4_t vclez_f16(float16x4_t __p0) {
44295 uint16x4_t __ret;
44296 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
44297 __ret = (uint16x4_t) __builtin_neon_vclez_v((int8x8_t)__rev0, 17);
44298 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
44299 return __ret;
44300}
44716#define vcopyq_laneq_s8(__p0_312, __p1_312, __p2_312, __p3_312) __extension__ ({ \
44717 int8x16_t __ret_312; \
44718 int8x16_t __s0_312 = __p0_312; \
44719 int8x16_t __s2_312 = __p2_312; \
44720 int8x16_t __rev0_312; __rev0_312 = __builtin_shufflevector(__s0_312, __s0_312, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
44721 int8x16_t __rev2_312; __rev2_312 = __builtin_shufflevector(__s2_312, __s2_312, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
44722 __ret_312 = __noswap_vsetq_lane_s8(__noswap_vgetq_lane_s8(__rev2_312, __p3_312), __rev0_312, __p1_312); \
44723 __ret_312 = __builtin_shufflevector(__ret_312, __ret_312, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
44724 __ret_312; \
44725})
4430144726#endif
4430244727
4430344728#ifdef __LITTLE_ENDIAN__
44304__ai uint16x8_t vcltq_f16(float16x8_t __p0, float16x8_t __p1) {
44305 uint16x8_t __ret;
44306 __ret = (uint16x8_t)(__p0 < __p1);
44307 return __ret;
44308}
44729#define vcopyq_laneq_f32(__p0_313, __p1_313, __p2_313, __p3_313) __extension__ ({ \
44730 float32x4_t __ret_313; \
44731 float32x4_t __s0_313 = __p0_313; \
44732 float32x4_t __s2_313 = __p2_313; \
44733 __ret_313 = vsetq_lane_f32(vgetq_lane_f32(__s2_313, __p3_313), __s0_313, __p1_313); \
44734 __ret_313; \
44735})
4430944736#else
44310__ai uint16x8_t vcltq_f16(float16x8_t __p0, float16x8_t __p1) {
44311 uint16x8_t __ret;
44312 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
44313 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
44314 __ret = (uint16x8_t)(__rev0 < __rev1);
44315 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
44316 return __ret;
44317}
44737#define vcopyq_laneq_f32(__p0_314, __p1_314, __p2_314, __p3_314) __extension__ ({ \
44738 float32x4_t __ret_314; \
44739 float32x4_t __s0_314 = __p0_314; \
44740 float32x4_t __s2_314 = __p2_314; \
44741 float32x4_t __rev0_314; __rev0_314 = __builtin_shufflevector(__s0_314, __s0_314, 3, 2, 1, 0); \
44742 float32x4_t __rev2_314; __rev2_314 = __builtin_shufflevector(__s2_314, __s2_314, 3, 2, 1, 0); \
44743 __ret_314 = __noswap_vsetq_lane_f32(__noswap_vgetq_lane_f32(__rev2_314, __p3_314), __rev0_314, __p1_314); \
44744 __ret_314 = __builtin_shufflevector(__ret_314, __ret_314, 3, 2, 1, 0); \
44745 __ret_314; \
44746})
4431844747#endif
4431944748
4432044749#ifdef __LITTLE_ENDIAN__
44321__ai uint16x4_t vclt_f16(float16x4_t __p0, float16x4_t __p1) {
44322 uint16x4_t __ret;
44323 __ret = (uint16x4_t)(__p0 < __p1);
44324 return __ret;
44325}
44750#define vcopyq_laneq_s32(__p0_315, __p1_315, __p2_315, __p3_315) __extension__ ({ \
44751 int32x4_t __ret_315; \
44752 int32x4_t __s0_315 = __p0_315; \
44753 int32x4_t __s2_315 = __p2_315; \
44754 __ret_315 = vsetq_lane_s32(vgetq_lane_s32(__s2_315, __p3_315), __s0_315, __p1_315); \
44755 __ret_315; \
44756})
4432644757#else
44327__ai uint16x4_t vclt_f16(float16x4_t __p0, float16x4_t __p1) {
44328 uint16x4_t __ret;
44329 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
44330 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
44331 __ret = (uint16x4_t)(__rev0 < __rev1);
44332 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
44333 return __ret;
44334}
44758#define vcopyq_laneq_s32(__p0_316, __p1_316, __p2_316, __p3_316) __extension__ ({ \
44759 int32x4_t __ret_316; \
44760 int32x4_t __s0_316 = __p0_316; \
44761 int32x4_t __s2_316 = __p2_316; \
44762 int32x4_t __rev0_316; __rev0_316 = __builtin_shufflevector(__s0_316, __s0_316, 3, 2, 1, 0); \
44763 int32x4_t __rev2_316; __rev2_316 = __builtin_shufflevector(__s2_316, __s2_316, 3, 2, 1, 0); \
44764 __ret_316 = __noswap_vsetq_lane_s32(__noswap_vgetq_lane_s32(__rev2_316, __p3_316), __rev0_316, __p1_316); \
44765 __ret_316 = __builtin_shufflevector(__ret_316, __ret_316, 3, 2, 1, 0); \
44766 __ret_316; \
44767})
4433544768#endif
4433644769
4433744770#ifdef __LITTLE_ENDIAN__
44338__ai uint16x8_t vcltzq_f16(float16x8_t __p0) {
44339 uint16x8_t __ret;
44340 __ret = (uint16x8_t) __builtin_neon_vcltzq_v((int8x16_t)__p0, 49);
44341 return __ret;
44342}
44771#define vcopyq_laneq_s64(__p0_317, __p1_317, __p2_317, __p3_317) __extension__ ({ \
44772 int64x2_t __ret_317; \
44773 int64x2_t __s0_317 = __p0_317; \
44774 int64x2_t __s2_317 = __p2_317; \
44775 __ret_317 = vsetq_lane_s64(vgetq_lane_s64(__s2_317, __p3_317), __s0_317, __p1_317); \
44776 __ret_317; \
44777})
4434344778#else
44344__ai uint16x8_t vcltzq_f16(float16x8_t __p0) {
44345 uint16x8_t __ret;
44346 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
44347 __ret = (uint16x8_t) __builtin_neon_vcltzq_v((int8x16_t)__rev0, 49);
44348 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
44349 return __ret;
44350}
44779#define vcopyq_laneq_s64(__p0_318, __p1_318, __p2_318, __p3_318) __extension__ ({ \
44780 int64x2_t __ret_318; \
44781 int64x2_t __s0_318 = __p0_318; \
44782 int64x2_t __s2_318 = __p2_318; \
44783 int64x2_t __rev0_318; __rev0_318 = __builtin_shufflevector(__s0_318, __s0_318, 1, 0); \
44784 int64x2_t __rev2_318; __rev2_318 = __builtin_shufflevector(__s2_318, __s2_318, 1, 0); \
44785 __ret_318 = __noswap_vsetq_lane_s64(__noswap_vgetq_lane_s64(__rev2_318, __p3_318), __rev0_318, __p1_318); \
44786 __ret_318 = __builtin_shufflevector(__ret_318, __ret_318, 1, 0); \
44787 __ret_318; \
44788})
4435144789#endif
4435244790
4435344791#ifdef __LITTLE_ENDIAN__
44354__ai uint16x4_t vcltz_f16(float16x4_t __p0) {
44355 uint16x4_t __ret;
44356 __ret = (uint16x4_t) __builtin_neon_vcltz_v((int8x8_t)__p0, 17);
44357 return __ret;
44358}
44792#define vcopyq_laneq_s16(__p0_319, __p1_319, __p2_319, __p3_319) __extension__ ({ \
44793 int16x8_t __ret_319; \
44794 int16x8_t __s0_319 = __p0_319; \
44795 int16x8_t __s2_319 = __p2_319; \
44796 __ret_319 = vsetq_lane_s16(vgetq_lane_s16(__s2_319, __p3_319), __s0_319, __p1_319); \
44797 __ret_319; \
44798})
4435944799#else
44360__ai uint16x4_t vcltz_f16(float16x4_t __p0) {
44361 uint16x4_t __ret;
44362 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
44363 __ret = (uint16x4_t) __builtin_neon_vcltz_v((int8x8_t)__rev0, 17);
44364 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
44365 return __ret;
44366}
44800#define vcopyq_laneq_s16(__p0_320, __p1_320, __p2_320, __p3_320) __extension__ ({ \
44801 int16x8_t __ret_320; \
44802 int16x8_t __s0_320 = __p0_320; \
44803 int16x8_t __s2_320 = __p2_320; \
44804 int16x8_t __rev0_320; __rev0_320 = __builtin_shufflevector(__s0_320, __s0_320, 7, 6, 5, 4, 3, 2, 1, 0); \
44805 int16x8_t __rev2_320; __rev2_320 = __builtin_shufflevector(__s2_320, __s2_320, 7, 6, 5, 4, 3, 2, 1, 0); \
44806 __ret_320 = __noswap_vsetq_lane_s16(__noswap_vgetq_lane_s16(__rev2_320, __p3_320), __rev0_320, __p1_320); \
44807 __ret_320 = __builtin_shufflevector(__ret_320, __ret_320, 7, 6, 5, 4, 3, 2, 1, 0); \
44808 __ret_320; \
44809})
4436744810#endif
4436844811
4436944812#ifdef __LITTLE_ENDIAN__
44370__ai float16x8_t vcvtq_f16_u16(uint16x8_t __p0) {
44371 float16x8_t __ret;
44372 __ret = (float16x8_t) __builtin_neon_vcvtq_f16_v((int8x16_t)__p0, 49);
44373 return __ret;
44374}
44813#define vcopy_laneq_p8(__p0_321, __p1_321, __p2_321, __p3_321) __extension__ ({ \
44814 poly8x8_t __ret_321; \
44815 poly8x8_t __s0_321 = __p0_321; \
44816 poly8x16_t __s2_321 = __p2_321; \
44817 __ret_321 = vset_lane_p8(vgetq_lane_p8(__s2_321, __p3_321), __s0_321, __p1_321); \
44818 __ret_321; \
44819})
4437544820#else
44376__ai float16x8_t vcvtq_f16_u16(uint16x8_t __p0) {
44377 float16x8_t __ret;
44378 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
44379 __ret = (float16x8_t) __builtin_neon_vcvtq_f16_v((int8x16_t)__rev0, 49);
44380 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
44381 return __ret;
44382}
44821#define vcopy_laneq_p8(__p0_322, __p1_322, __p2_322, __p3_322) __extension__ ({ \
44822 poly8x8_t __ret_322; \
44823 poly8x8_t __s0_322 = __p0_322; \
44824 poly8x16_t __s2_322 = __p2_322; \
44825 poly8x8_t __rev0_322; __rev0_322 = __builtin_shufflevector(__s0_322, __s0_322, 7, 6, 5, 4, 3, 2, 1, 0); \
44826 poly8x16_t __rev2_322; __rev2_322 = __builtin_shufflevector(__s2_322, __s2_322, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
44827 __ret_322 = __noswap_vset_lane_p8(__noswap_vgetq_lane_p8(__rev2_322, __p3_322), __rev0_322, __p1_322); \
44828 __ret_322 = __builtin_shufflevector(__ret_322, __ret_322, 7, 6, 5, 4, 3, 2, 1, 0); \
44829 __ret_322; \
44830})
4438344831#endif
4438444832
4438544833#ifdef __LITTLE_ENDIAN__
44386__ai float16x8_t vcvtq_f16_s16(int16x8_t __p0) {
44387 float16x8_t __ret;
44388 __ret = (float16x8_t) __builtin_neon_vcvtq_f16_v((int8x16_t)__p0, 33);
44389 return __ret;
44390}
44834#define vcopy_laneq_p16(__p0_323, __p1_323, __p2_323, __p3_323) __extension__ ({ \
44835 poly16x4_t __ret_323; \
44836 poly16x4_t __s0_323 = __p0_323; \
44837 poly16x8_t __s2_323 = __p2_323; \
44838 __ret_323 = vset_lane_p16(vgetq_lane_p16(__s2_323, __p3_323), __s0_323, __p1_323); \
44839 __ret_323; \
44840})
4439144841#else
44392__ai float16x8_t vcvtq_f16_s16(int16x8_t __p0) {
44393 float16x8_t __ret;
44394 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
44395 __ret = (float16x8_t) __builtin_neon_vcvtq_f16_v((int8x16_t)__rev0, 33);
44396 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
44397 return __ret;
44398}
44842#define vcopy_laneq_p16(__p0_324, __p1_324, __p2_324, __p3_324) __extension__ ({ \
44843 poly16x4_t __ret_324; \
44844 poly16x4_t __s0_324 = __p0_324; \
44845 poly16x8_t __s2_324 = __p2_324; \
44846 poly16x4_t __rev0_324; __rev0_324 = __builtin_shufflevector(__s0_324, __s0_324, 3, 2, 1, 0); \
44847 poly16x8_t __rev2_324; __rev2_324 = __builtin_shufflevector(__s2_324, __s2_324, 7, 6, 5, 4, 3, 2, 1, 0); \
44848 __ret_324 = __noswap_vset_lane_p16(__noswap_vgetq_lane_p16(__rev2_324, __p3_324), __rev0_324, __p1_324); \
44849 __ret_324 = __builtin_shufflevector(__ret_324, __ret_324, 3, 2, 1, 0); \
44850 __ret_324; \
44851})
4439944852#endif
4440044853
4440144854#ifdef __LITTLE_ENDIAN__
44402__ai float16x4_t vcvt_f16_u16(uint16x4_t __p0) {
44403 float16x4_t __ret;
44404 __ret = (float16x4_t) __builtin_neon_vcvt_f16_v((int8x8_t)__p0, 17);
44405 return __ret;
44406}
44855#define vcopy_laneq_u8(__p0_325, __p1_325, __p2_325, __p3_325) __extension__ ({ \
44856 uint8x8_t __ret_325; \
44857 uint8x8_t __s0_325 = __p0_325; \
44858 uint8x16_t __s2_325 = __p2_325; \
44859 __ret_325 = vset_lane_u8(vgetq_lane_u8(__s2_325, __p3_325), __s0_325, __p1_325); \
44860 __ret_325; \
44861})
4440744862#else
44408__ai float16x4_t vcvt_f16_u16(uint16x4_t __p0) {
44409 float16x4_t __ret;
44410 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
44411 __ret = (float16x4_t) __builtin_neon_vcvt_f16_v((int8x8_t)__rev0, 17);
44412 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
44413 return __ret;
44414}
44863#define vcopy_laneq_u8(__p0_326, __p1_326, __p2_326, __p3_326) __extension__ ({ \
44864 uint8x8_t __ret_326; \
44865 uint8x8_t __s0_326 = __p0_326; \
44866 uint8x16_t __s2_326 = __p2_326; \
44867 uint8x8_t __rev0_326; __rev0_326 = __builtin_shufflevector(__s0_326, __s0_326, 7, 6, 5, 4, 3, 2, 1, 0); \
44868 uint8x16_t __rev2_326; __rev2_326 = __builtin_shufflevector(__s2_326, __s2_326, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
44869 __ret_326 = __noswap_vset_lane_u8(__noswap_vgetq_lane_u8(__rev2_326, __p3_326), __rev0_326, __p1_326); \
44870 __ret_326 = __builtin_shufflevector(__ret_326, __ret_326, 7, 6, 5, 4, 3, 2, 1, 0); \
44871 __ret_326; \
44872})
4441544873#endif
4441644874
4441744875#ifdef __LITTLE_ENDIAN__
44418__ai float16x4_t vcvt_f16_s16(int16x4_t __p0) {
44419 float16x4_t __ret;
44420 __ret = (float16x4_t) __builtin_neon_vcvt_f16_v((int8x8_t)__p0, 1);
44421 return __ret;
44422}
44876#define vcopy_laneq_u32(__p0_327, __p1_327, __p2_327, __p3_327) __extension__ ({ \
44877 uint32x2_t __ret_327; \
44878 uint32x2_t __s0_327 = __p0_327; \
44879 uint32x4_t __s2_327 = __p2_327; \
44880 __ret_327 = vset_lane_u32(vgetq_lane_u32(__s2_327, __p3_327), __s0_327, __p1_327); \
44881 __ret_327; \
44882})
4442344883#else
44424__ai float16x4_t vcvt_f16_s16(int16x4_t __p0) {
44425 float16x4_t __ret;
44426 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
44427 __ret = (float16x4_t) __builtin_neon_vcvt_f16_v((int8x8_t)__rev0, 1);
44428 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
44429 return __ret;
44430}
44884#define vcopy_laneq_u32(__p0_328, __p1_328, __p2_328, __p3_328) __extension__ ({ \
44885 uint32x2_t __ret_328; \
44886 uint32x2_t __s0_328 = __p0_328; \
44887 uint32x4_t __s2_328 = __p2_328; \
44888 uint32x2_t __rev0_328; __rev0_328 = __builtin_shufflevector(__s0_328, __s0_328, 1, 0); \
44889 uint32x4_t __rev2_328; __rev2_328 = __builtin_shufflevector(__s2_328, __s2_328, 3, 2, 1, 0); \
44890 __ret_328 = __noswap_vset_lane_u32(__noswap_vgetq_lane_u32(__rev2_328, __p3_328), __rev0_328, __p1_328); \
44891 __ret_328 = __builtin_shufflevector(__ret_328, __ret_328, 1, 0); \
44892 __ret_328; \
44893})
4443144894#endif
4443244895
4443344896#ifdef __LITTLE_ENDIAN__
44434#define vcvtq_n_f16_u16(__p0, __p1) __extension__ ({ \
44435 float16x8_t __ret; \
44436 uint16x8_t __s0 = __p0; \
44437 __ret = (float16x8_t) __builtin_neon_vcvtq_n_f16_v((int8x16_t)__s0, __p1, 49); \
44438 __ret; \
44897#define vcopy_laneq_u64(__p0_329, __p1_329, __p2_329, __p3_329) __extension__ ({ \
44898 uint64x1_t __ret_329; \
44899 uint64x1_t __s0_329 = __p0_329; \
44900 uint64x2_t __s2_329 = __p2_329; \
44901 __ret_329 = vset_lane_u64(vgetq_lane_u64(__s2_329, __p3_329), __s0_329, __p1_329); \
44902 __ret_329; \
4443944903})
4444044904#else
44441#define vcvtq_n_f16_u16(__p0, __p1) __extension__ ({ \
44442 float16x8_t __ret; \
44443 uint16x8_t __s0 = __p0; \
44444 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
44445 __ret = (float16x8_t) __builtin_neon_vcvtq_n_f16_v((int8x16_t)__rev0, __p1, 49); \
44446 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
44447 __ret; \
44905#define vcopy_laneq_u64(__p0_330, __p1_330, __p2_330, __p3_330) __extension__ ({ \
44906 uint64x1_t __ret_330; \
44907 uint64x1_t __s0_330 = __p0_330; \
44908 uint64x2_t __s2_330 = __p2_330; \
44909 uint64x2_t __rev2_330; __rev2_330 = __builtin_shufflevector(__s2_330, __s2_330, 1, 0); \
44910 __ret_330 = vset_lane_u64(__noswap_vgetq_lane_u64(__rev2_330, __p3_330), __s0_330, __p1_330); \
44911 __ret_330; \
4444844912})
4444944913#endif
4445044914
4445144915#ifdef __LITTLE_ENDIAN__
44452#define vcvtq_n_f16_s16(__p0, __p1) __extension__ ({ \
44453 float16x8_t __ret; \
44454 int16x8_t __s0 = __p0; \
44455 __ret = (float16x8_t) __builtin_neon_vcvtq_n_f16_v((int8x16_t)__s0, __p1, 33); \
44456 __ret; \
44916#define vcopy_laneq_u16(__p0_331, __p1_331, __p2_331, __p3_331) __extension__ ({ \
44917 uint16x4_t __ret_331; \
44918 uint16x4_t __s0_331 = __p0_331; \
44919 uint16x8_t __s2_331 = __p2_331; \
44920 __ret_331 = vset_lane_u16(vgetq_lane_u16(__s2_331, __p3_331), __s0_331, __p1_331); \
44921 __ret_331; \
4445744922})
4445844923#else
44459#define vcvtq_n_f16_s16(__p0, __p1) __extension__ ({ \
44460 float16x8_t __ret; \
44461 int16x8_t __s0 = __p0; \
44462 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
44463 __ret = (float16x8_t) __builtin_neon_vcvtq_n_f16_v((int8x16_t)__rev0, __p1, 33); \
44464 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
44465 __ret; \
44924#define vcopy_laneq_u16(__p0_332, __p1_332, __p2_332, __p3_332) __extension__ ({ \
44925 uint16x4_t __ret_332; \
44926 uint16x4_t __s0_332 = __p0_332; \
44927 uint16x8_t __s2_332 = __p2_332; \
44928 uint16x4_t __rev0_332; __rev0_332 = __builtin_shufflevector(__s0_332, __s0_332, 3, 2, 1, 0); \
44929 uint16x8_t __rev2_332; __rev2_332 = __builtin_shufflevector(__s2_332, __s2_332, 7, 6, 5, 4, 3, 2, 1, 0); \
44930 __ret_332 = __noswap_vset_lane_u16(__noswap_vgetq_lane_u16(__rev2_332, __p3_332), __rev0_332, __p1_332); \
44931 __ret_332 = __builtin_shufflevector(__ret_332, __ret_332, 3, 2, 1, 0); \
44932 __ret_332; \
4446644933})
4446744934#endif
4446844935
4446944936#ifdef __LITTLE_ENDIAN__
44470#define vcvt_n_f16_u16(__p0, __p1) __extension__ ({ \
44471 float16x4_t __ret; \
44472 uint16x4_t __s0 = __p0; \
44473 __ret = (float16x4_t) __builtin_neon_vcvt_n_f16_v((int8x8_t)__s0, __p1, 17); \
44474 __ret; \
44937#define vcopy_laneq_s8(__p0_333, __p1_333, __p2_333, __p3_333) __extension__ ({ \
44938 int8x8_t __ret_333; \
44939 int8x8_t __s0_333 = __p0_333; \
44940 int8x16_t __s2_333 = __p2_333; \
44941 __ret_333 = vset_lane_s8(vgetq_lane_s8(__s2_333, __p3_333), __s0_333, __p1_333); \
44942 __ret_333; \
4447544943})
4447644944#else
44477#define vcvt_n_f16_u16(__p0, __p1) __extension__ ({ \
44478 float16x4_t __ret; \
44479 uint16x4_t __s0 = __p0; \
44480 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
44481 __ret = (float16x4_t) __builtin_neon_vcvt_n_f16_v((int8x8_t)__rev0, __p1, 17); \
44482 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
44483 __ret; \
44945#define vcopy_laneq_s8(__p0_334, __p1_334, __p2_334, __p3_334) __extension__ ({ \
44946 int8x8_t __ret_334; \
44947 int8x8_t __s0_334 = __p0_334; \
44948 int8x16_t __s2_334 = __p2_334; \
44949 int8x8_t __rev0_334; __rev0_334 = __builtin_shufflevector(__s0_334, __s0_334, 7, 6, 5, 4, 3, 2, 1, 0); \
44950 int8x16_t __rev2_334; __rev2_334 = __builtin_shufflevector(__s2_334, __s2_334, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
44951 __ret_334 = __noswap_vset_lane_s8(__noswap_vgetq_lane_s8(__rev2_334, __p3_334), __rev0_334, __p1_334); \
44952 __ret_334 = __builtin_shufflevector(__ret_334, __ret_334, 7, 6, 5, 4, 3, 2, 1, 0); \
44953 __ret_334; \
4448444954})
4448544955#endif
4448644956
4448744957#ifdef __LITTLE_ENDIAN__
44488#define vcvt_n_f16_s16(__p0, __p1) __extension__ ({ \
44489 float16x4_t __ret; \
44490 int16x4_t __s0 = __p0; \
44491 __ret = (float16x4_t) __builtin_neon_vcvt_n_f16_v((int8x8_t)__s0, __p1, 1); \
44492 __ret; \
44958#define vcopy_laneq_f32(__p0_335, __p1_335, __p2_335, __p3_335) __extension__ ({ \
44959 float32x2_t __ret_335; \
44960 float32x2_t __s0_335 = __p0_335; \
44961 float32x4_t __s2_335 = __p2_335; \
44962 __ret_335 = vset_lane_f32(vgetq_lane_f32(__s2_335, __p3_335), __s0_335, __p1_335); \
44963 __ret_335; \
4449344964})
4449444965#else
44495#define vcvt_n_f16_s16(__p0, __p1) __extension__ ({ \
44496 float16x4_t __ret; \
44497 int16x4_t __s0 = __p0; \
44498 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
44499 __ret = (float16x4_t) __builtin_neon_vcvt_n_f16_v((int8x8_t)__rev0, __p1, 1); \
44500 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
44501 __ret; \
44966#define vcopy_laneq_f32(__p0_336, __p1_336, __p2_336, __p3_336) __extension__ ({ \
44967 float32x2_t __ret_336; \
44968 float32x2_t __s0_336 = __p0_336; \
44969 float32x4_t __s2_336 = __p2_336; \
44970 float32x2_t __rev0_336; __rev0_336 = __builtin_shufflevector(__s0_336, __s0_336, 1, 0); \
44971 float32x4_t __rev2_336; __rev2_336 = __builtin_shufflevector(__s2_336, __s2_336, 3, 2, 1, 0); \
44972 __ret_336 = __noswap_vset_lane_f32(__noswap_vgetq_lane_f32(__rev2_336, __p3_336), __rev0_336, __p1_336); \
44973 __ret_336 = __builtin_shufflevector(__ret_336, __ret_336, 1, 0); \
44974 __ret_336; \
4450244975})
4450344976#endif
4450444977
4450544978#ifdef __LITTLE_ENDIAN__
44506#define vcvtq_n_s16_f16(__p0, __p1) __extension__ ({ \
44507 int16x8_t __ret; \
44508 float16x8_t __s0 = __p0; \
44509 __ret = (int16x8_t) __builtin_neon_vcvtq_n_s16_v((int8x16_t)__s0, __p1, 33); \
44510 __ret; \
44979#define vcopy_laneq_s32(__p0_337, __p1_337, __p2_337, __p3_337) __extension__ ({ \
44980 int32x2_t __ret_337; \
44981 int32x2_t __s0_337 = __p0_337; \
44982 int32x4_t __s2_337 = __p2_337; \
44983 __ret_337 = vset_lane_s32(vgetq_lane_s32(__s2_337, __p3_337), __s0_337, __p1_337); \
44984 __ret_337; \
4451144985})
4451244986#else
44513#define vcvtq_n_s16_f16(__p0, __p1) __extension__ ({ \
44514 int16x8_t __ret; \
44515 float16x8_t __s0 = __p0; \
44516 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
44517 __ret = (int16x8_t) __builtin_neon_vcvtq_n_s16_v((int8x16_t)__rev0, __p1, 33); \
44518 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
44519 __ret; \
44987#define vcopy_laneq_s32(__p0_338, __p1_338, __p2_338, __p3_338) __extension__ ({ \
44988 int32x2_t __ret_338; \
44989 int32x2_t __s0_338 = __p0_338; \
44990 int32x4_t __s2_338 = __p2_338; \
44991 int32x2_t __rev0_338; __rev0_338 = __builtin_shufflevector(__s0_338, __s0_338, 1, 0); \
44992 int32x4_t __rev2_338; __rev2_338 = __builtin_shufflevector(__s2_338, __s2_338, 3, 2, 1, 0); \
44993 __ret_338 = __noswap_vset_lane_s32(__noswap_vgetq_lane_s32(__rev2_338, __p3_338), __rev0_338, __p1_338); \
44994 __ret_338 = __builtin_shufflevector(__ret_338, __ret_338, 1, 0); \
44995 __ret_338; \
4452044996})
4452144997#endif
4452244998
4452344999#ifdef __LITTLE_ENDIAN__
44524#define vcvt_n_s16_f16(__p0, __p1) __extension__ ({ \
44525 int16x4_t __ret; \
44526 float16x4_t __s0 = __p0; \
44527 __ret = (int16x4_t) __builtin_neon_vcvt_n_s16_v((int8x8_t)__s0, __p1, 1); \
44528 __ret; \
45000#define vcopy_laneq_s64(__p0_339, __p1_339, __p2_339, __p3_339) __extension__ ({ \
45001 int64x1_t __ret_339; \
45002 int64x1_t __s0_339 = __p0_339; \
45003 int64x2_t __s2_339 = __p2_339; \
45004 __ret_339 = vset_lane_s64(vgetq_lane_s64(__s2_339, __p3_339), __s0_339, __p1_339); \
45005 __ret_339; \
4452945006})
4453045007#else
44531#define vcvt_n_s16_f16(__p0, __p1) __extension__ ({ \
44532 int16x4_t __ret; \
44533 float16x4_t __s0 = __p0; \
44534 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
44535 __ret = (int16x4_t) __builtin_neon_vcvt_n_s16_v((int8x8_t)__rev0, __p1, 1); \
44536 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
44537 __ret; \
45008#define vcopy_laneq_s64(__p0_340, __p1_340, __p2_340, __p3_340) __extension__ ({ \
45009 int64x1_t __ret_340; \
45010 int64x1_t __s0_340 = __p0_340; \
45011 int64x2_t __s2_340 = __p2_340; \
45012 int64x2_t __rev2_340; __rev2_340 = __builtin_shufflevector(__s2_340, __s2_340, 1, 0); \
45013 __ret_340 = vset_lane_s64(__noswap_vgetq_lane_s64(__rev2_340, __p3_340), __s0_340, __p1_340); \
45014 __ret_340; \
4453845015})
4453945016#endif
4454045017
4454145018#ifdef __LITTLE_ENDIAN__
44542#define vcvtq_n_u16_f16(__p0, __p1) __extension__ ({ \
44543 uint16x8_t __ret; \
44544 float16x8_t __s0 = __p0; \
44545 __ret = (uint16x8_t) __builtin_neon_vcvtq_n_u16_v((int8x16_t)__s0, __p1, 49); \
44546 __ret; \
45019#define vcopy_laneq_s16(__p0_341, __p1_341, __p2_341, __p3_341) __extension__ ({ \
45020 int16x4_t __ret_341; \
45021 int16x4_t __s0_341 = __p0_341; \
45022 int16x8_t __s2_341 = __p2_341; \
45023 __ret_341 = vset_lane_s16(vgetq_lane_s16(__s2_341, __p3_341), __s0_341, __p1_341); \
45024 __ret_341; \
4454745025})
4454845026#else
44549#define vcvtq_n_u16_f16(__p0, __p1) __extension__ ({ \
44550 uint16x8_t __ret; \
44551 float16x8_t __s0 = __p0; \
44552 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
44553 __ret = (uint16x8_t) __builtin_neon_vcvtq_n_u16_v((int8x16_t)__rev0, __p1, 49); \
44554 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
44555 __ret; \
45027#define vcopy_laneq_s16(__p0_342, __p1_342, __p2_342, __p3_342) __extension__ ({ \
45028 int16x4_t __ret_342; \
45029 int16x4_t __s0_342 = __p0_342; \
45030 int16x8_t __s2_342 = __p2_342; \
45031 int16x4_t __rev0_342; __rev0_342 = __builtin_shufflevector(__s0_342, __s0_342, 3, 2, 1, 0); \
45032 int16x8_t __rev2_342; __rev2_342 = __builtin_shufflevector(__s2_342, __s2_342, 7, 6, 5, 4, 3, 2, 1, 0); \
45033 __ret_342 = __noswap_vset_lane_s16(__noswap_vgetq_lane_s16(__rev2_342, __p3_342), __rev0_342, __p1_342); \
45034 __ret_342 = __builtin_shufflevector(__ret_342, __ret_342, 3, 2, 1, 0); \
45035 __ret_342; \
4455645036})
4455745037#endif
4455845038
44559#ifdef __LITTLE_ENDIAN__
44560#define vcvt_n_u16_f16(__p0, __p1) __extension__ ({ \
44561 uint16x4_t __ret; \
44562 float16x4_t __s0 = __p0; \
44563 __ret = (uint16x4_t) __builtin_neon_vcvt_n_u16_v((int8x8_t)__s0, __p1, 17); \
45039#define vcreate_p64(__p0) __extension__ ({ \
45040 poly64x1_t __ret; \
45041 uint64_t __promote = __p0; \
45042 __ret = (poly64x1_t)(__promote); \
4456445043 __ret; \
4456545044})
44566#else
44567#define vcvt_n_u16_f16(__p0, __p1) __extension__ ({ \
44568 uint16x4_t __ret; \
44569 float16x4_t __s0 = __p0; \
44570 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
44571 __ret = (uint16x4_t) __builtin_neon_vcvt_n_u16_v((int8x8_t)__rev0, __p1, 17); \
44572 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
45045#define vcreate_f64(__p0) __extension__ ({ \
45046 float64x1_t __ret; \
45047 uint64_t __promote = __p0; \
45048 __ret = (float64x1_t)(__promote); \
4457345049 __ret; \
4457445050})
44575#endif
44576
44577#ifdef __LITTLE_ENDIAN__
44578__ai int16x8_t vcvtq_s16_f16(float16x8_t __p0) {
44579 int16x8_t __ret;
44580 __ret = (int16x8_t) __builtin_neon_vcvtq_s16_v((int8x16_t)__p0, 33);
45051__ai float32_t vcvts_f32_s32(int32_t __p0) {
45052 float32_t __ret;
45053 __ret = (float32_t) __builtin_neon_vcvts_f32_s32(__p0);
4458145054 return __ret;
4458245055}
44583#else
44584__ai int16x8_t vcvtq_s16_f16(float16x8_t __p0) {
44585 int16x8_t __ret;
44586 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
44587 __ret = (int16x8_t) __builtin_neon_vcvtq_s16_v((int8x16_t)__rev0, 33);
44588 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
45056__ai float32_t vcvts_f32_u32(uint32_t __p0) {
45057 float32_t __ret;
45058 __ret = (float32_t) __builtin_neon_vcvts_f32_u32(__p0);
4458945059 return __ret;
4459045060}
44591#endif
44592
4459345061#ifdef __LITTLE_ENDIAN__
44594__ai int16x4_t vcvt_s16_f16(float16x4_t __p0) {
44595 int16x4_t __ret;
44596 __ret = (int16x4_t) __builtin_neon_vcvt_s16_v((int8x8_t)__p0, 1);
45062__ai float32x2_t vcvt_f32_f64(float64x2_t __p0) {
45063 float32x2_t __ret;
45064 __ret = (float32x2_t) __builtin_neon_vcvt_f32_f64((int8x16_t)__p0, 9);
4459745065 return __ret;
4459845066}
4459945067#else
44600__ai int16x4_t vcvt_s16_f16(float16x4_t __p0) {
44601 int16x4_t __ret;
44602 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
44603 __ret = (int16x4_t) __builtin_neon_vcvt_s16_v((int8x8_t)__rev0, 1);
44604 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
45068__ai float32x2_t vcvt_f32_f64(float64x2_t __p0) {
45069 float32x2_t __ret;
45070 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
45071 __ret = (float32x2_t) __builtin_neon_vcvt_f32_f64((int8x16_t)__rev0, 9);
45072 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
45073 return __ret;
45074}
45075__ai float32x2_t __noswap_vcvt_f32_f64(float64x2_t __p0) {
45076 float32x2_t __ret;
45077 __ret = (float32x2_t) __builtin_neon_vcvt_f32_f64((int8x16_t)__p0, 9);
4460545078 return __ret;
4460645079}
4460745080#endif
4460845081
44609#ifdef __LITTLE_ENDIAN__
44610__ai uint16x8_t vcvtq_u16_f16(float16x8_t __p0) {
44611 uint16x8_t __ret;
44612 __ret = (uint16x8_t) __builtin_neon_vcvtq_u16_v((int8x16_t)__p0, 49);
45082__ai float64_t vcvtd_f64_s64(int64_t __p0) {
45083 float64_t __ret;
45084 __ret = (float64_t) __builtin_neon_vcvtd_f64_s64(__p0);
4461345085 return __ret;
4461445086}
44615#else
44616__ai uint16x8_t vcvtq_u16_f16(float16x8_t __p0) {
44617 uint16x8_t __ret;
44618 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
44619 __ret = (uint16x8_t) __builtin_neon_vcvtq_u16_v((int8x16_t)__rev0, 49);
44620 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
45087__ai float64_t vcvtd_f64_u64(uint64_t __p0) {
45088 float64_t __ret;
45089 __ret = (float64_t) __builtin_neon_vcvtd_f64_u64(__p0);
4462145090 return __ret;
4462245091}
44623#endif
44624
4462545092#ifdef __LITTLE_ENDIAN__
44626__ai uint16x4_t vcvt_u16_f16(float16x4_t __p0) {
44627 uint16x4_t __ret;
44628 __ret = (uint16x4_t) __builtin_neon_vcvt_u16_v((int8x8_t)__p0, 17);
45093__ai float64x2_t vcvtq_f64_u64(uint64x2_t __p0) {
45094 float64x2_t __ret;
45095 __ret = (float64x2_t) __builtin_neon_vcvtq_f64_v((int8x16_t)__p0, 51);
4462945096 return __ret;
4463045097}
4463145098#else
44632__ai uint16x4_t vcvt_u16_f16(float16x4_t __p0) {
44633 uint16x4_t __ret;
44634 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
44635 __ret = (uint16x4_t) __builtin_neon_vcvt_u16_v((int8x8_t)__rev0, 17);
44636 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
45099__ai float64x2_t vcvtq_f64_u64(uint64x2_t __p0) {
45100 float64x2_t __ret;
45101 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
45102 __ret = (float64x2_t) __builtin_neon_vcvtq_f64_v((int8x16_t)__rev0, 51);
45103 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4463745104 return __ret;
4463845105}
4463945106#endif
4464045107
4464145108#ifdef __LITTLE_ENDIAN__
44642__ai int16x8_t vcvtaq_s16_f16(float16x8_t __p0) {
44643 int16x8_t __ret;
44644 __ret = (int16x8_t) __builtin_neon_vcvtaq_s16_v((int8x16_t)__p0, 33);
45109__ai float64x2_t vcvtq_f64_s64(int64x2_t __p0) {
45110 float64x2_t __ret;
45111 __ret = (float64x2_t) __builtin_neon_vcvtq_f64_v((int8x16_t)__p0, 35);
4464545112 return __ret;
4464645113}
4464745114#else
44648__ai int16x8_t vcvtaq_s16_f16(float16x8_t __p0) {
44649 int16x8_t __ret;
44650 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
44651 __ret = (int16x8_t) __builtin_neon_vcvtaq_s16_v((int8x16_t)__rev0, 33);
44652 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
45115__ai float64x2_t vcvtq_f64_s64(int64x2_t __p0) {
45116 float64x2_t __ret;
45117 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
45118 __ret = (float64x2_t) __builtin_neon_vcvtq_f64_v((int8x16_t)__rev0, 35);
45119 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4465345120 return __ret;
4465445121}
4465545122#endif
4465645123
44657#ifdef __LITTLE_ENDIAN__
44658__ai int16x4_t vcvta_s16_f16(float16x4_t __p0) {
44659 int16x4_t __ret;
44660 __ret = (int16x4_t) __builtin_neon_vcvta_s16_v((int8x8_t)__p0, 1);
45124__ai float64x1_t vcvt_f64_u64(uint64x1_t __p0) {
45125 float64x1_t __ret;
45126 __ret = (float64x1_t) __builtin_neon_vcvt_f64_v((int8x8_t)__p0, 19);
4466145127 return __ret;
4466245128}
44663#else
44664__ai int16x4_t vcvta_s16_f16(float16x4_t __p0) {
44665 int16x4_t __ret;
44666 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
44667 __ret = (int16x4_t) __builtin_neon_vcvta_s16_v((int8x8_t)__rev0, 1);
44668 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
45129__ai float64x1_t vcvt_f64_s64(int64x1_t __p0) {
45130 float64x1_t __ret;
45131 __ret = (float64x1_t) __builtin_neon_vcvt_f64_v((int8x8_t)__p0, 3);
4466945132 return __ret;
4467045133}
44671#endif
44672
4467345134#ifdef __LITTLE_ENDIAN__
44674__ai uint16x8_t vcvtaq_u16_f16(float16x8_t __p0) {
44675 uint16x8_t __ret;
44676 __ret = (uint16x8_t) __builtin_neon_vcvtaq_u16_v((int8x16_t)__p0, 49);
45135__ai float64x2_t vcvt_f64_f32(float32x2_t __p0) {
45136 float64x2_t __ret;
45137 __ret = (float64x2_t) __builtin_neon_vcvt_f64_f32((int8x8_t)__p0, 42);
4467745138 return __ret;
4467845139}
4467945140#else
44680__ai uint16x8_t vcvtaq_u16_f16(float16x8_t __p0) {
44681 uint16x8_t __ret;
44682 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
44683 __ret = (uint16x8_t) __builtin_neon_vcvtaq_u16_v((int8x16_t)__rev0, 49);
44684 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
45141__ai float64x2_t vcvt_f64_f32(float32x2_t __p0) {
45142 float64x2_t __ret;
45143 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
45144 __ret = (float64x2_t) __builtin_neon_vcvt_f64_f32((int8x8_t)__rev0, 42);
45145 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
45146 return __ret;
45147}
45148__ai float64x2_t __noswap_vcvt_f64_f32(float32x2_t __p0) {
45149 float64x2_t __ret;
45150 __ret = (float64x2_t) __builtin_neon_vcvt_f64_f32((int8x8_t)__p0, 42);
4468545151 return __ret;
4468645152}
4468745153#endif
4468845154
4468945155#ifdef __LITTLE_ENDIAN__
44690__ai uint16x4_t vcvta_u16_f16(float16x4_t __p0) {
44691 uint16x4_t __ret;
44692 __ret = (uint16x4_t) __builtin_neon_vcvta_u16_v((int8x8_t)__p0, 17);
45156__ai float16x8_t vcvt_high_f16_f32(float16x4_t __p0, float32x4_t __p1) {
45157 float16x8_t __ret;
45158 __ret = vcombine_f16(__p0, vcvt_f16_f32(__p1));
4469345159 return __ret;
4469445160}
4469545161#else
44696__ai uint16x4_t vcvta_u16_f16(float16x4_t __p0) {
44697 uint16x4_t __ret;
45162__ai float16x8_t vcvt_high_f16_f32(float16x4_t __p0, float32x4_t __p1) {
45163 float16x8_t __ret;
4469845164 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
44699 __ret = (uint16x4_t) __builtin_neon_vcvta_u16_v((int8x8_t)__rev0, 17);
44700 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
45165 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
45166 __ret = __noswap_vcombine_f16(__rev0, __noswap_vcvt_f16_f32(__rev1));
45167 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
4470145168 return __ret;
4470245169}
4470345170#endif
4470445171
4470545172#ifdef __LITTLE_ENDIAN__
44706__ai int16x8_t vcvtmq_s16_f16(float16x8_t __p0) {
44707 int16x8_t __ret;
44708 __ret = (int16x8_t) __builtin_neon_vcvtmq_s16_v((int8x16_t)__p0, 33);
45173__ai float32x4_t vcvt_high_f32_f16(float16x8_t __p0) {
45174 float32x4_t __ret;
45175 __ret = vcvt_f32_f16(vget_high_f16(__p0));
4470945176 return __ret;
4471045177}
4471145178#else
44712__ai int16x8_t vcvtmq_s16_f16(float16x8_t __p0) {
44713 int16x8_t __ret;
45179__ai float32x4_t vcvt_high_f32_f16(float16x8_t __p0) {
45180 float32x4_t __ret;
4471445181 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
44715 __ret = (int16x8_t) __builtin_neon_vcvtmq_s16_v((int8x16_t)__rev0, 33);
44716 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
45182 __ret = __noswap_vcvt_f32_f16(__noswap_vget_high_f16(__rev0));
45183 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
4471745184 return __ret;
4471845185}
4471945186#endif
4472045187
4472145188#ifdef __LITTLE_ENDIAN__
44722__ai int16x4_t vcvtm_s16_f16(float16x4_t __p0) {
44723 int16x4_t __ret;
44724 __ret = (int16x4_t) __builtin_neon_vcvtm_s16_v((int8x8_t)__p0, 1);
45189__ai float32x4_t vcvt_high_f32_f64(float32x2_t __p0, float64x2_t __p1) {
45190 float32x4_t __ret;
45191 __ret = vcombine_f32(__p0, vcvt_f32_f64(__p1));
4472545192 return __ret;
4472645193}
4472745194#else
44728__ai int16x4_t vcvtm_s16_f16(float16x4_t __p0) {
44729 int16x4_t __ret;
44730 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
44731 __ret = (int16x4_t) __builtin_neon_vcvtm_s16_v((int8x8_t)__rev0, 1);
45195__ai float32x4_t vcvt_high_f32_f64(float32x2_t __p0, float64x2_t __p1) {
45196 float32x4_t __ret;
45197 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
45198 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
45199 __ret = __noswap_vcombine_f32(__rev0, __noswap_vcvt_f32_f64(__rev1));
4473245200 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
4473345201 return __ret;
4473445202}
4473545203#endif
4473645204
4473745205#ifdef __LITTLE_ENDIAN__
44738__ai uint16x8_t vcvtmq_u16_f16(float16x8_t __p0) {
44739 uint16x8_t __ret;
44740 __ret = (uint16x8_t) __builtin_neon_vcvtmq_u16_v((int8x16_t)__p0, 49);
45206__ai float64x2_t vcvt_high_f64_f32(float32x4_t __p0) {
45207 float64x2_t __ret;
45208 __ret = vcvt_f64_f32(vget_high_f32(__p0));
4474145209 return __ret;
4474245210}
4474345211#else
44744__ai uint16x8_t vcvtmq_u16_f16(float16x8_t __p0) {
44745 uint16x8_t __ret;
44746 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
44747 __ret = (uint16x8_t) __builtin_neon_vcvtmq_u16_v((int8x16_t)__rev0, 49);
44748 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
45212__ai float64x2_t vcvt_high_f64_f32(float32x4_t __p0) {
45213 float64x2_t __ret;
45214 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
45215 __ret = __noswap_vcvt_f64_f32(__noswap_vget_high_f32(__rev0));
45216 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4474945217 return __ret;
4475045218}
4475145219#endif
4475245220
45221#define vcvts_n_f32_u32(__p0, __p1) __extension__ ({ \
45222 float32_t __ret; \
45223 uint32_t __s0 = __p0; \
45224 __ret = (float32_t) __builtin_neon_vcvts_n_f32_u32(__s0, __p1); \
45225 __ret; \
45226})
45227#define vcvts_n_f32_s32(__p0, __p1) __extension__ ({ \
45228 float32_t __ret; \
45229 int32_t __s0 = __p0; \
45230 __ret = (float32_t) __builtin_neon_vcvts_n_f32_s32(__s0, __p1); \
45231 __ret; \
45232})
4475345233#ifdef __LITTLE_ENDIAN__
44754__ai uint16x4_t vcvtm_u16_f16(float16x4_t __p0) {
44755 uint16x4_t __ret;
44756 __ret = (uint16x4_t) __builtin_neon_vcvtm_u16_v((int8x8_t)__p0, 17);
44757 return __ret;
44758}
45234#define vcvtq_n_f64_u64(__p0, __p1) __extension__ ({ \
45235 float64x2_t __ret; \
45236 uint64x2_t __s0 = __p0; \
45237 __ret = (float64x2_t) __builtin_neon_vcvtq_n_f64_v((int8x16_t)__s0, __p1, 51); \
45238 __ret; \
45239})
4475945240#else
44760__ai uint16x4_t vcvtm_u16_f16(float16x4_t __p0) {
44761 uint16x4_t __ret;
44762 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
44763 __ret = (uint16x4_t) __builtin_neon_vcvtm_u16_v((int8x8_t)__rev0, 17);
44764 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
44765 return __ret;
44766}
45241#define vcvtq_n_f64_u64(__p0, __p1) __extension__ ({ \
45242 float64x2_t __ret; \
45243 uint64x2_t __s0 = __p0; \
45244 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
45245 __ret = (float64x2_t) __builtin_neon_vcvtq_n_f64_v((int8x16_t)__rev0, __p1, 51); \
45246 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
45247 __ret; \
45248})
4476745249#endif
4476845250
4476945251#ifdef __LITTLE_ENDIAN__
44770__ai int16x8_t vcvtnq_s16_f16(float16x8_t __p0) {
44771 int16x8_t __ret;
44772 __ret = (int16x8_t) __builtin_neon_vcvtnq_s16_v((int8x16_t)__p0, 33);
44773 return __ret;
44774}
45252#define vcvtq_n_f64_s64(__p0, __p1) __extension__ ({ \
45253 float64x2_t __ret; \
45254 int64x2_t __s0 = __p0; \
45255 __ret = (float64x2_t) __builtin_neon_vcvtq_n_f64_v((int8x16_t)__s0, __p1, 35); \
45256 __ret; \
45257})
4477545258#else
44776__ai int16x8_t vcvtnq_s16_f16(float16x8_t __p0) {
44777 int16x8_t __ret;
44778 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
44779 __ret = (int16x8_t) __builtin_neon_vcvtnq_s16_v((int8x16_t)__rev0, 33);
44780 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
44781 return __ret;
44782}
45259#define vcvtq_n_f64_s64(__p0, __p1) __extension__ ({ \
45260 float64x2_t __ret; \
45261 int64x2_t __s0 = __p0; \
45262 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
45263 __ret = (float64x2_t) __builtin_neon_vcvtq_n_f64_v((int8x16_t)__rev0, __p1, 35); \
45264 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
45265 __ret; \
45266})
45267#endif
45268
45269#define vcvt_n_f64_u64(__p0, __p1) __extension__ ({ \
45270 float64x1_t __ret; \
45271 uint64x1_t __s0 = __p0; \
45272 __ret = (float64x1_t) __builtin_neon_vcvt_n_f64_v((int8x8_t)__s0, __p1, 19); \
45273 __ret; \
45274})
45275#define vcvt_n_f64_s64(__p0, __p1) __extension__ ({ \
45276 float64x1_t __ret; \
45277 int64x1_t __s0 = __p0; \
45278 __ret = (float64x1_t) __builtin_neon_vcvt_n_f64_v((int8x8_t)__s0, __p1, 3); \
45279 __ret; \
45280})
45281#define vcvtd_n_f64_u64(__p0, __p1) __extension__ ({ \
45282 float64_t __ret; \
45283 uint64_t __s0 = __p0; \
45284 __ret = (float64_t) __builtin_neon_vcvtd_n_f64_u64(__s0, __p1); \
45285 __ret; \
45286})
45287#define vcvtd_n_f64_s64(__p0, __p1) __extension__ ({ \
45288 float64_t __ret; \
45289 int64_t __s0 = __p0; \
45290 __ret = (float64_t) __builtin_neon_vcvtd_n_f64_s64(__s0, __p1); \
45291 __ret; \
45292})
45293#define vcvts_n_s32_f32(__p0, __p1) __extension__ ({ \
45294 int32_t __ret; \
45295 float32_t __s0 = __p0; \
45296 __ret = (int32_t) __builtin_neon_vcvts_n_s32_f32(__s0, __p1); \
45297 __ret; \
45298})
45299#ifdef __LITTLE_ENDIAN__
45300#define vcvtq_n_s64_f64(__p0, __p1) __extension__ ({ \
45301 int64x2_t __ret; \
45302 float64x2_t __s0 = __p0; \
45303 __ret = (int64x2_t) __builtin_neon_vcvtq_n_s64_v((int8x16_t)__s0, __p1, 35); \
45304 __ret; \
45305})
45306#else
45307#define vcvtq_n_s64_f64(__p0, __p1) __extension__ ({ \
45308 int64x2_t __ret; \
45309 float64x2_t __s0 = __p0; \
45310 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
45311 __ret = (int64x2_t) __builtin_neon_vcvtq_n_s64_v((int8x16_t)__rev0, __p1, 35); \
45312 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
45313 __ret; \
45314})
4478345315#endif
4478445316
45317#define vcvt_n_s64_f64(__p0, __p1) __extension__ ({ \
45318 int64x1_t __ret; \
45319 float64x1_t __s0 = __p0; \
45320 __ret = (int64x1_t) __builtin_neon_vcvt_n_s64_v((int8x8_t)__s0, __p1, 3); \
45321 __ret; \
45322})
45323#define vcvtd_n_s64_f64(__p0, __p1) __extension__ ({ \
45324 int64_t __ret; \
45325 float64_t __s0 = __p0; \
45326 __ret = (int64_t) __builtin_neon_vcvtd_n_s64_f64(__s0, __p1); \
45327 __ret; \
45328})
45329#define vcvts_n_u32_f32(__p0, __p1) __extension__ ({ \
45330 uint32_t __ret; \
45331 float32_t __s0 = __p0; \
45332 __ret = (uint32_t) __builtin_neon_vcvts_n_u32_f32(__s0, __p1); \
45333 __ret; \
45334})
4478545335#ifdef __LITTLE_ENDIAN__
44786__ai int16x4_t vcvtn_s16_f16(float16x4_t __p0) {
44787 int16x4_t __ret;
44788 __ret = (int16x4_t) __builtin_neon_vcvtn_s16_v((int8x8_t)__p0, 1);
45336#define vcvtq_n_u64_f64(__p0, __p1) __extension__ ({ \
45337 uint64x2_t __ret; \
45338 float64x2_t __s0 = __p0; \
45339 __ret = (uint64x2_t) __builtin_neon_vcvtq_n_u64_v((int8x16_t)__s0, __p1, 51); \
45340 __ret; \
45341})
45342#else
45343#define vcvtq_n_u64_f64(__p0, __p1) __extension__ ({ \
45344 uint64x2_t __ret; \
45345 float64x2_t __s0 = __p0; \
45346 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
45347 __ret = (uint64x2_t) __builtin_neon_vcvtq_n_u64_v((int8x16_t)__rev0, __p1, 51); \
45348 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
45349 __ret; \
45350})
45351#endif
45352
45353#define vcvt_n_u64_f64(__p0, __p1) __extension__ ({ \
45354 uint64x1_t __ret; \
45355 float64x1_t __s0 = __p0; \
45356 __ret = (uint64x1_t) __builtin_neon_vcvt_n_u64_v((int8x8_t)__s0, __p1, 19); \
45357 __ret; \
45358})
45359#define vcvtd_n_u64_f64(__p0, __p1) __extension__ ({ \
45360 uint64_t __ret; \
45361 float64_t __s0 = __p0; \
45362 __ret = (uint64_t) __builtin_neon_vcvtd_n_u64_f64(__s0, __p1); \
45363 __ret; \
45364})
45365__ai int32_t vcvts_s32_f32(float32_t __p0) {
45366 int32_t __ret;
45367 __ret = (int32_t) __builtin_neon_vcvts_s32_f32(__p0);
4478945368 return __ret;
4479045369}
44791#else
44792__ai int16x4_t vcvtn_s16_f16(float16x4_t __p0) {
44793 int16x4_t __ret;
44794 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
44795 __ret = (int16x4_t) __builtin_neon_vcvtn_s16_v((int8x8_t)__rev0, 1);
44796 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
45370__ai int64_t vcvtd_s64_f64(float64_t __p0) {
45371 int64_t __ret;
45372 __ret = (int64_t) __builtin_neon_vcvtd_s64_f64(__p0);
4479745373 return __ret;
4479845374}
44799#endif
44800
4480145375#ifdef __LITTLE_ENDIAN__
44802__ai uint16x8_t vcvtnq_u16_f16(float16x8_t __p0) {
44803 uint16x8_t __ret;
44804 __ret = (uint16x8_t) __builtin_neon_vcvtnq_u16_v((int8x16_t)__p0, 49);
45376__ai int64x2_t vcvtq_s64_f64(float64x2_t __p0) {
45377 int64x2_t __ret;
45378 __ret = (int64x2_t) __builtin_neon_vcvtq_s64_v((int8x16_t)__p0, 35);
4480545379 return __ret;
4480645380}
4480745381#else
44808__ai uint16x8_t vcvtnq_u16_f16(float16x8_t __p0) {
44809 uint16x8_t __ret;
44810 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
44811 __ret = (uint16x8_t) __builtin_neon_vcvtnq_u16_v((int8x16_t)__rev0, 49);
44812 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
45382__ai int64x2_t vcvtq_s64_f64(float64x2_t __p0) {
45383 int64x2_t __ret;
45384 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
45385 __ret = (int64x2_t) __builtin_neon_vcvtq_s64_v((int8x16_t)__rev0, 35);
45386 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4481345387 return __ret;
4481445388}
4481545389#endif
4481645390
44817#ifdef __LITTLE_ENDIAN__
44818__ai uint16x4_t vcvtn_u16_f16(float16x4_t __p0) {
44819 uint16x4_t __ret;
44820 __ret = (uint16x4_t) __builtin_neon_vcvtn_u16_v((int8x8_t)__p0, 17);
45391__ai int64x1_t vcvt_s64_f64(float64x1_t __p0) {
45392 int64x1_t __ret;
45393 __ret = (int64x1_t) __builtin_neon_vcvt_s64_v((int8x8_t)__p0, 3);
4482145394 return __ret;
4482245395}
44823#else
44824__ai uint16x4_t vcvtn_u16_f16(float16x4_t __p0) {
44825 uint16x4_t __ret;
44826 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
44827 __ret = (uint16x4_t) __builtin_neon_vcvtn_u16_v((int8x8_t)__rev0, 17);
44828 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
45396__ai uint32_t vcvts_u32_f32(float32_t __p0) {
45397 uint32_t __ret;
45398 __ret = (uint32_t) __builtin_neon_vcvts_u32_f32(__p0);
45399 return __ret;
45400}
45401__ai uint64_t vcvtd_u64_f64(float64_t __p0) {
45402 uint64_t __ret;
45403 __ret = (uint64_t) __builtin_neon_vcvtd_u64_f64(__p0);
4482945404 return __ret;
4483045405}
44831#endif
44832
4483345406#ifdef __LITTLE_ENDIAN__
44834__ai int16x8_t vcvtpq_s16_f16(float16x8_t __p0) {
44835 int16x8_t __ret;
44836 __ret = (int16x8_t) __builtin_neon_vcvtpq_s16_v((int8x16_t)__p0, 33);
45407__ai uint64x2_t vcvtq_u64_f64(float64x2_t __p0) {
45408 uint64x2_t __ret;
45409 __ret = (uint64x2_t) __builtin_neon_vcvtq_u64_v((int8x16_t)__p0, 51);
4483745410 return __ret;
4483845411}
4483945412#else
44840__ai int16x8_t vcvtpq_s16_f16(float16x8_t __p0) {
44841 int16x8_t __ret;
44842 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
44843 __ret = (int16x8_t) __builtin_neon_vcvtpq_s16_v((int8x16_t)__rev0, 33);
44844 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
45413__ai uint64x2_t vcvtq_u64_f64(float64x2_t __p0) {
45414 uint64x2_t __ret;
45415 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
45416 __ret = (uint64x2_t) __builtin_neon_vcvtq_u64_v((int8x16_t)__rev0, 51);
45417 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4484545418 return __ret;
4484645419}
4484745420#endif
4484845421
44849#ifdef __LITTLE_ENDIAN__
44850__ai int16x4_t vcvtp_s16_f16(float16x4_t __p0) {
44851 int16x4_t __ret;
44852 __ret = (int16x4_t) __builtin_neon_vcvtp_s16_v((int8x8_t)__p0, 1);
45422__ai uint64x1_t vcvt_u64_f64(float64x1_t __p0) {
45423 uint64x1_t __ret;
45424 __ret = (uint64x1_t) __builtin_neon_vcvt_u64_v((int8x8_t)__p0, 19);
4485345425 return __ret;
4485445426}
44855#else
44856__ai int16x4_t vcvtp_s16_f16(float16x4_t __p0) {
44857 int16x4_t __ret;
44858 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
44859 __ret = (int16x4_t) __builtin_neon_vcvtp_s16_v((int8x8_t)__rev0, 1);
44860 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
45427__ai int32_t vcvtas_s32_f32(float32_t __p0) {
45428 int32_t __ret;
45429 __ret = (int32_t) __builtin_neon_vcvtas_s32_f32(__p0);
4486145430 return __ret;
4486245431}
44863#endif
44864
4486545432#ifdef __LITTLE_ENDIAN__
44866__ai uint16x8_t vcvtpq_u16_f16(float16x8_t __p0) {
44867 uint16x8_t __ret;
44868 __ret = (uint16x8_t) __builtin_neon_vcvtpq_u16_v((int8x16_t)__p0, 49);
45433__ai int64x2_t vcvtaq_s64_f64(float64x2_t __p0) {
45434 int64x2_t __ret;
45435 __ret = (int64x2_t) __builtin_neon_vcvtaq_s64_v((int8x16_t)__p0, 35);
4486945436 return __ret;
4487045437}
4487145438#else
44872__ai uint16x8_t vcvtpq_u16_f16(float16x8_t __p0) {
44873 uint16x8_t __ret;
44874 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
44875 __ret = (uint16x8_t) __builtin_neon_vcvtpq_u16_v((int8x16_t)__rev0, 49);
44876 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
45439__ai int64x2_t vcvtaq_s64_f64(float64x2_t __p0) {
45440 int64x2_t __ret;
45441 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
45442 __ret = (int64x2_t) __builtin_neon_vcvtaq_s64_v((int8x16_t)__rev0, 35);
45443 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4487745444 return __ret;
4487845445}
4487945446#endif
4488045447
44881#ifdef __LITTLE_ENDIAN__
44882__ai uint16x4_t vcvtp_u16_f16(float16x4_t __p0) {
44883 uint16x4_t __ret;
44884 __ret = (uint16x4_t) __builtin_neon_vcvtp_u16_v((int8x8_t)__p0, 17);
45448__ai int64x1_t vcvta_s64_f64(float64x1_t __p0) {
45449 int64x1_t __ret;
45450 __ret = (int64x1_t) __builtin_neon_vcvta_s64_v((int8x8_t)__p0, 3);
4488545451 return __ret;
4488645452}
44887#else
44888__ai uint16x4_t vcvtp_u16_f16(float16x4_t __p0) {
44889 uint16x4_t __ret;
44890 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
44891 __ret = (uint16x4_t) __builtin_neon_vcvtp_u16_v((int8x8_t)__rev0, 17);
44892 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
45453__ai int64_t vcvtad_s64_f64(float64_t __p0) {
45454 int64_t __ret;
45455 __ret = (int64_t) __builtin_neon_vcvtad_s64_f64(__p0);
45456 return __ret;
45457}
45458__ai uint32_t vcvtas_u32_f32(float32_t __p0) {
45459 uint32_t __ret;
45460 __ret = (uint32_t) __builtin_neon_vcvtas_u32_f32(__p0);
4489345461 return __ret;
4489445462}
44895#endif
44896
44897#ifdef __LITTLE_ENDIAN__
44898#define vextq_f16(__p0, __p1, __p2) __extension__ ({ \
44899 float16x8_t __ret; \
44900 float16x8_t __s0 = __p0; \
44901 float16x8_t __s1 = __p1; \
44902 __ret = (float16x8_t) __builtin_neon_vextq_v((int8x16_t)__s0, (int8x16_t)__s1, __p2, 40); \
44903 __ret; \
44904})
44905#else
44906#define vextq_f16(__p0, __p1, __p2) __extension__ ({ \
44907 float16x8_t __ret; \
44908 float16x8_t __s0 = __p0; \
44909 float16x8_t __s1 = __p1; \
44910 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
44911 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
44912 __ret = (float16x8_t) __builtin_neon_vextq_v((int8x16_t)__rev0, (int8x16_t)__rev1, __p2, 40); \
44913 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
44914 __ret; \
44915})
44916#endif
44917
4491845463#ifdef __LITTLE_ENDIAN__
44919#define vext_f16(__p0, __p1, __p2) __extension__ ({ \
44920 float16x4_t __ret; \
44921 float16x4_t __s0 = __p0; \
44922 float16x4_t __s1 = __p1; \
44923 __ret = (float16x4_t) __builtin_neon_vext_v((int8x8_t)__s0, (int8x8_t)__s1, __p2, 8); \
44924 __ret; \
44925})
45464__ai uint64x2_t vcvtaq_u64_f64(float64x2_t __p0) {
45465 uint64x2_t __ret;
45466 __ret = (uint64x2_t) __builtin_neon_vcvtaq_u64_v((int8x16_t)__p0, 51);
45467 return __ret;
45468}
4492645469#else
44927#define vext_f16(__p0, __p1, __p2) __extension__ ({ \
44928 float16x4_t __ret; \
44929 float16x4_t __s0 = __p0; \
44930 float16x4_t __s1 = __p1; \
44931 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
44932 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
44933 __ret = (float16x4_t) __builtin_neon_vext_v((int8x8_t)__rev0, (int8x8_t)__rev1, __p2, 8); \
44934 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
44935 __ret; \
44936})
45470__ai uint64x2_t vcvtaq_u64_f64(float64x2_t __p0) {
45471 uint64x2_t __ret;
45472 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
45473 __ret = (uint64x2_t) __builtin_neon_vcvtaq_u64_v((int8x16_t)__rev0, 51);
45474 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
45475 return __ret;
45476}
4493745477#endif
4493845478
44939#ifdef __LITTLE_ENDIAN__
44940__ai float16x8_t vfmaq_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
44941 float16x8_t __ret;
44942 __ret = (float16x8_t) __builtin_neon_vfmaq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 40);
45479__ai uint64x1_t vcvta_u64_f64(float64x1_t __p0) {
45480 uint64x1_t __ret;
45481 __ret = (uint64x1_t) __builtin_neon_vcvta_u64_v((int8x8_t)__p0, 19);
4494345482 return __ret;
4494445483}
44945#else
44946__ai float16x8_t vfmaq_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
44947 float16x8_t __ret;
44948 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
44949 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
44950 float16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
44951 __ret = (float16x8_t) __builtin_neon_vfmaq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 40);
44952 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
45484__ai uint64_t vcvtad_u64_f64(float64_t __p0) {
45485 uint64_t __ret;
45486 __ret = (uint64_t) __builtin_neon_vcvtad_u64_f64(__p0);
45487 return __ret;
45488}
45489__ai int32_t vcvtms_s32_f32(float32_t __p0) {
45490 int32_t __ret;
45491 __ret = (int32_t) __builtin_neon_vcvtms_s32_f32(__p0);
45492 return __ret;
45493}
45494#ifdef __LITTLE_ENDIAN__
45495__ai int64x2_t vcvtmq_s64_f64(float64x2_t __p0) {
45496 int64x2_t __ret;
45497 __ret = (int64x2_t) __builtin_neon_vcvtmq_s64_v((int8x16_t)__p0, 35);
4495345498 return __ret;
4495445499}
44955__ai float16x8_t __noswap_vfmaq_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
44956 float16x8_t __ret;
44957 __ret = (float16x8_t) __builtin_neon_vfmaq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 40);
45500#else
45501__ai int64x2_t vcvtmq_s64_f64(float64x2_t __p0) {
45502 int64x2_t __ret;
45503 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
45504 __ret = (int64x2_t) __builtin_neon_vcvtmq_s64_v((int8x16_t)__rev0, 35);
45505 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4495845506 return __ret;
4495945507}
4496045508#endif
4496145509
44962#ifdef __LITTLE_ENDIAN__
44963__ai float16x4_t vfma_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
44964 float16x4_t __ret;
44965 __ret = (float16x4_t) __builtin_neon_vfma_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 8);
45510__ai int64x1_t vcvtm_s64_f64(float64x1_t __p0) {
45511 int64x1_t __ret;
45512 __ret = (int64x1_t) __builtin_neon_vcvtm_s64_v((int8x8_t)__p0, 3);
4496645513 return __ret;
4496745514}
44968#else
44969__ai float16x4_t vfma_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
44970 float16x4_t __ret;
44971 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
44972 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
44973 float16x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
44974 __ret = (float16x4_t) __builtin_neon_vfma_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 8);
44975 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
45515__ai int64_t vcvtmd_s64_f64(float64_t __p0) {
45516 int64_t __ret;
45517 __ret = (int64_t) __builtin_neon_vcvtmd_s64_f64(__p0);
4497645518 return __ret;
4497745519}
44978__ai float16x4_t __noswap_vfma_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
44979 float16x4_t __ret;
44980 __ret = (float16x4_t) __builtin_neon_vfma_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 8);
45520__ai uint32_t vcvtms_u32_f32(float32_t __p0) {
45521 uint32_t __ret;
45522 __ret = (uint32_t) __builtin_neon_vcvtms_u32_f32(__p0);
4498145523 return __ret;
4498245524}
44983#endif
44984
4498545525#ifdef __LITTLE_ENDIAN__
44986__ai float16x8_t vfmsq_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
44987 float16x8_t __ret;
44988 __ret = vfmaq_f16(__p0, -__p1, __p2);
45526__ai uint64x2_t vcvtmq_u64_f64(float64x2_t __p0) {
45527 uint64x2_t __ret;
45528 __ret = (uint64x2_t) __builtin_neon_vcvtmq_u64_v((int8x16_t)__p0, 51);
4498945529 return __ret;
4499045530}
4499145531#else
44992__ai float16x8_t vfmsq_f16(float16x8_t __p0, float16x8_t __p1, float16x8_t __p2) {
44993 float16x8_t __ret;
44994 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
44995 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
44996 float16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
44997 __ret = __noswap_vfmaq_f16(__rev0, -__rev1, __rev2);
44998 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
45532__ai uint64x2_t vcvtmq_u64_f64(float64x2_t __p0) {
45533 uint64x2_t __ret;
45534 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
45535 __ret = (uint64x2_t) __builtin_neon_vcvtmq_u64_v((int8x16_t)__rev0, 51);
45536 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4499945537 return __ret;
4500045538}
4500145539#endif
4500245540
45003#ifdef __LITTLE_ENDIAN__
45004__ai float16x4_t vfms_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
45005 float16x4_t __ret;
45006 __ret = vfma_f16(__p0, -__p1, __p2);
45541__ai uint64x1_t vcvtm_u64_f64(float64x1_t __p0) {
45542 uint64x1_t __ret;
45543 __ret = (uint64x1_t) __builtin_neon_vcvtm_u64_v((int8x8_t)__p0, 19);
4500745544 return __ret;
4500845545}
45009#else
45010__ai float16x4_t vfms_f16(float16x4_t __p0, float16x4_t __p1, float16x4_t __p2) {
45011 float16x4_t __ret;
45012 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
45013 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
45014 float16x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
45015 __ret = __noswap_vfma_f16(__rev0, -__rev1, __rev2);
45016 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
45546__ai uint64_t vcvtmd_u64_f64(float64_t __p0) {
45547 uint64_t __ret;
45548 __ret = (uint64_t) __builtin_neon_vcvtmd_u64_f64(__p0);
45549 return __ret;
45550}
45551__ai int32_t vcvtns_s32_f32(float32_t __p0) {
45552 int32_t __ret;
45553 __ret = (int32_t) __builtin_neon_vcvtns_s32_f32(__p0);
4501745554 return __ret;
4501845555}
45019#endif
45020
4502145556#ifdef __LITTLE_ENDIAN__
45022__ai float16x8_t vmaxq_f16(float16x8_t __p0, float16x8_t __p1) {
45023 float16x8_t __ret;
45024 __ret = (float16x8_t) __builtin_neon_vmaxq_v((int8x16_t)__p0, (int8x16_t)__p1, 40);
45557__ai int64x2_t vcvtnq_s64_f64(float64x2_t __p0) {
45558 int64x2_t __ret;
45559 __ret = (int64x2_t) __builtin_neon_vcvtnq_s64_v((int8x16_t)__p0, 35);
4502545560 return __ret;
4502645561}
4502745562#else
45028__ai float16x8_t vmaxq_f16(float16x8_t __p0, float16x8_t __p1) {
45029 float16x8_t __ret;
45030 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
45031 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
45032 __ret = (float16x8_t) __builtin_neon_vmaxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
45033 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
45563__ai int64x2_t vcvtnq_s64_f64(float64x2_t __p0) {
45564 int64x2_t __ret;
45565 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
45566 __ret = (int64x2_t) __builtin_neon_vcvtnq_s64_v((int8x16_t)__rev0, 35);
45567 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4503445568 return __ret;
4503545569}
4503645570#endif
4503745571
45038#ifdef __LITTLE_ENDIAN__
45039__ai float16x4_t vmax_f16(float16x4_t __p0, float16x4_t __p1) {
45040 float16x4_t __ret;
45041 __ret = (float16x4_t) __builtin_neon_vmax_v((int8x8_t)__p0, (int8x8_t)__p1, 8);
45572__ai int64x1_t vcvtn_s64_f64(float64x1_t __p0) {
45573 int64x1_t __ret;
45574 __ret = (int64x1_t) __builtin_neon_vcvtn_s64_v((int8x8_t)__p0, 3);
4504245575 return __ret;
4504345576}
45044#else
45045__ai float16x4_t vmax_f16(float16x4_t __p0, float16x4_t __p1) {
45046 float16x4_t __ret;
45047 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
45048 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
45049 __ret = (float16x4_t) __builtin_neon_vmax_v((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
45050 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
45577__ai int64_t vcvtnd_s64_f64(float64_t __p0) {
45578 int64_t __ret;
45579 __ret = (int64_t) __builtin_neon_vcvtnd_s64_f64(__p0);
45580 return __ret;
45581}
45582__ai uint32_t vcvtns_u32_f32(float32_t __p0) {
45583 uint32_t __ret;
45584 __ret = (uint32_t) __builtin_neon_vcvtns_u32_f32(__p0);
4505145585 return __ret;
4505245586}
45053#endif
45054
4505545587#ifdef __LITTLE_ENDIAN__
45056__ai float16x8_t vminq_f16(float16x8_t __p0, float16x8_t __p1) {
45057 float16x8_t __ret;
45058 __ret = (float16x8_t) __builtin_neon_vminq_v((int8x16_t)__p0, (int8x16_t)__p1, 40);
45588__ai uint64x2_t vcvtnq_u64_f64(float64x2_t __p0) {
45589 uint64x2_t __ret;
45590 __ret = (uint64x2_t) __builtin_neon_vcvtnq_u64_v((int8x16_t)__p0, 51);
4505945591 return __ret;
4506045592}
4506145593#else
45062__ai float16x8_t vminq_f16(float16x8_t __p0, float16x8_t __p1) {
45063 float16x8_t __ret;
45064 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
45065 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
45066 __ret = (float16x8_t) __builtin_neon_vminq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
45067 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
45594__ai uint64x2_t vcvtnq_u64_f64(float64x2_t __p0) {
45595 uint64x2_t __ret;
45596 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
45597 __ret = (uint64x2_t) __builtin_neon_vcvtnq_u64_v((int8x16_t)__rev0, 51);
45598 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4506845599 return __ret;
4506945600}
4507045601#endif
4507145602
45072#ifdef __LITTLE_ENDIAN__
45073__ai float16x4_t vmin_f16(float16x4_t __p0, float16x4_t __p1) {
45074 float16x4_t __ret;
45075 __ret = (float16x4_t) __builtin_neon_vmin_v((int8x8_t)__p0, (int8x8_t)__p1, 8);
45603__ai uint64x1_t vcvtn_u64_f64(float64x1_t __p0) {
45604 uint64x1_t __ret;
45605 __ret = (uint64x1_t) __builtin_neon_vcvtn_u64_v((int8x8_t)__p0, 19);
4507645606 return __ret;
4507745607}
45078#else
45079__ai float16x4_t vmin_f16(float16x4_t __p0, float16x4_t __p1) {
45080 float16x4_t __ret;
45081 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
45082 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
45083 __ret = (float16x4_t) __builtin_neon_vmin_v((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
45084 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
45608__ai uint64_t vcvtnd_u64_f64(float64_t __p0) {
45609 uint64_t __ret;
45610 __ret = (uint64_t) __builtin_neon_vcvtnd_u64_f64(__p0);
45611 return __ret;
45612}
45613__ai int32_t vcvtps_s32_f32(float32_t __p0) {
45614 int32_t __ret;
45615 __ret = (int32_t) __builtin_neon_vcvtps_s32_f32(__p0);
4508545616 return __ret;
4508645617}
45087#endif
45088
4508945618#ifdef __LITTLE_ENDIAN__
45090__ai float16x8_t vmulq_f16(float16x8_t __p0, float16x8_t __p1) {
45091 float16x8_t __ret;
45092 __ret = __p0 * __p1;
45619__ai int64x2_t vcvtpq_s64_f64(float64x2_t __p0) {
45620 int64x2_t __ret;
45621 __ret = (int64x2_t) __builtin_neon_vcvtpq_s64_v((int8x16_t)__p0, 35);
4509345622 return __ret;
4509445623}
4509545624#else
45096__ai float16x8_t vmulq_f16(float16x8_t __p0, float16x8_t __p1) {
45097 float16x8_t __ret;
45098 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
45099 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
45100 __ret = __rev0 * __rev1;
45101 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
45625__ai int64x2_t vcvtpq_s64_f64(float64x2_t __p0) {
45626 int64x2_t __ret;
45627 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
45628 __ret = (int64x2_t) __builtin_neon_vcvtpq_s64_v((int8x16_t)__rev0, 35);
45629 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4510245630 return __ret;
4510345631}
4510445632#endif
4510545633
45106#ifdef __LITTLE_ENDIAN__
45107__ai float16x4_t vmul_f16(float16x4_t __p0, float16x4_t __p1) {
45108 float16x4_t __ret;
45109 __ret = __p0 * __p1;
45634__ai int64x1_t vcvtp_s64_f64(float64x1_t __p0) {
45635 int64x1_t __ret;
45636 __ret = (int64x1_t) __builtin_neon_vcvtp_s64_v((int8x8_t)__p0, 3);
4511045637 return __ret;
4511145638}
45112#else
45113__ai float16x4_t vmul_f16(float16x4_t __p0, float16x4_t __p1) {
45114 float16x4_t __ret;
45115 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
45116 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
45117 __ret = __rev0 * __rev1;
45118 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
45639__ai int64_t vcvtpd_s64_f64(float64_t __p0) {
45640 int64_t __ret;
45641 __ret = (int64_t) __builtin_neon_vcvtpd_s64_f64(__p0);
45642 return __ret;
45643}
45644__ai uint32_t vcvtps_u32_f32(float32_t __p0) {
45645 uint32_t __ret;
45646 __ret = (uint32_t) __builtin_neon_vcvtps_u32_f32(__p0);
4511945647 return __ret;
4512045648}
45121#endif
45122
45123#ifdef __LITTLE_ENDIAN__
45124#define vmulq_lane_f16(__p0_277, __p1_277, __p2_277) __extension__ ({ \
45125 float16x8_t __ret_277; \
45126 float16x8_t __s0_277 = __p0_277; \
45127 float16x4_t __s1_277 = __p1_277; \
45128 __ret_277 = __s0_277 * splatq_lane_f16(__s1_277, __p2_277); \
45129 __ret_277; \
45130})
45131#else
45132#define vmulq_lane_f16(__p0_278, __p1_278, __p2_278) __extension__ ({ \
45133 float16x8_t __ret_278; \
45134 float16x8_t __s0_278 = __p0_278; \
45135 float16x4_t __s1_278 = __p1_278; \
45136 float16x8_t __rev0_278; __rev0_278 = __builtin_shufflevector(__s0_278, __s0_278, 7, 6, 5, 4, 3, 2, 1, 0); \
45137 float16x4_t __rev1_278; __rev1_278 = __builtin_shufflevector(__s1_278, __s1_278, 3, 2, 1, 0); \
45138 __ret_278 = __rev0_278 * __noswap_splatq_lane_f16(__rev1_278, __p2_278); \
45139 __ret_278 = __builtin_shufflevector(__ret_278, __ret_278, 7, 6, 5, 4, 3, 2, 1, 0); \
45140 __ret_278; \
45141})
45142#endif
45143
45144#ifdef __LITTLE_ENDIAN__
45145#define vmul_lane_f16(__p0_279, __p1_279, __p2_279) __extension__ ({ \
45146 float16x4_t __ret_279; \
45147 float16x4_t __s0_279 = __p0_279; \
45148 float16x4_t __s1_279 = __p1_279; \
45149 __ret_279 = __s0_279 * splat_lane_f16(__s1_279, __p2_279); \
45150 __ret_279; \
45151})
45152#else
45153#define vmul_lane_f16(__p0_280, __p1_280, __p2_280) __extension__ ({ \
45154 float16x4_t __ret_280; \
45155 float16x4_t __s0_280 = __p0_280; \
45156 float16x4_t __s1_280 = __p1_280; \
45157 float16x4_t __rev0_280; __rev0_280 = __builtin_shufflevector(__s0_280, __s0_280, 3, 2, 1, 0); \
45158 float16x4_t __rev1_280; __rev1_280 = __builtin_shufflevector(__s1_280, __s1_280, 3, 2, 1, 0); \
45159 __ret_280 = __rev0_280 * __noswap_splat_lane_f16(__rev1_280, __p2_280); \
45160 __ret_280 = __builtin_shufflevector(__ret_280, __ret_280, 3, 2, 1, 0); \
45161 __ret_280; \
45162})
45163#endif
45164
45165#ifdef __LITTLE_ENDIAN__
45166#define vmulq_n_f16(__p0, __p1) __extension__ ({ \
45167 float16x8_t __ret; \
45168 float16x8_t __s0 = __p0; \
45169 float16_t __s1 = __p1; \
45170 __ret = __s0 * (float16x8_t) {__s1, __s1, __s1, __s1, __s1, __s1, __s1, __s1}; \
45171 __ret; \
45172})
45173#else
45174#define vmulq_n_f16(__p0, __p1) __extension__ ({ \
45175 float16x8_t __ret; \
45176 float16x8_t __s0 = __p0; \
45177 float16_t __s1 = __p1; \
45178 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
45179 __ret = __rev0 * (float16x8_t) {__s1, __s1, __s1, __s1, __s1, __s1, __s1, __s1}; \
45180 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
45181 __ret; \
45182})
45183#endif
45184
45185#ifdef __LITTLE_ENDIAN__
45186#define vmul_n_f16(__p0, __p1) __extension__ ({ \
45187 float16x4_t __ret; \
45188 float16x4_t __s0 = __p0; \
45189 float16_t __s1 = __p1; \
45190 __ret = __s0 * (float16x4_t) {__s1, __s1, __s1, __s1}; \
45191 __ret; \
45192})
45193#else
45194#define vmul_n_f16(__p0, __p1) __extension__ ({ \
45195 float16x4_t __ret; \
45196 float16x4_t __s0 = __p0; \
45197 float16_t __s1 = __p1; \
45198 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
45199 __ret = __rev0 * (float16x4_t) {__s1, __s1, __s1, __s1}; \
45200 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
45201 __ret; \
45202})
45203#endif
45204
4520545649#ifdef __LITTLE_ENDIAN__
45206__ai float16x8_t vnegq_f16(float16x8_t __p0) {
45207 float16x8_t __ret;
45208 __ret = -__p0;
45650__ai uint64x2_t vcvtpq_u64_f64(float64x2_t __p0) {
45651 uint64x2_t __ret;
45652 __ret = (uint64x2_t) __builtin_neon_vcvtpq_u64_v((int8x16_t)__p0, 51);
4520945653 return __ret;
4521045654}
4521145655#else
45212__ai float16x8_t vnegq_f16(float16x8_t __p0) {
45213 float16x8_t __ret;
45214 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
45215 __ret = -__rev0;
45216 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
45656__ai uint64x2_t vcvtpq_u64_f64(float64x2_t __p0) {
45657 uint64x2_t __ret;
45658 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
45659 __ret = (uint64x2_t) __builtin_neon_vcvtpq_u64_v((int8x16_t)__rev0, 51);
45660 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4521745661 return __ret;
4521845662}
4521945663#endif
4522045664
45665__ai uint64x1_t vcvtp_u64_f64(float64x1_t __p0) {
45666 uint64x1_t __ret;
45667 __ret = (uint64x1_t) __builtin_neon_vcvtp_u64_v((int8x8_t)__p0, 19);
45668 return __ret;
45669}
45670__ai uint64_t vcvtpd_u64_f64(float64_t __p0) {
45671 uint64_t __ret;
45672 __ret = (uint64_t) __builtin_neon_vcvtpd_u64_f64(__p0);
45673 return __ret;
45674}
45675__ai float32_t vcvtxd_f32_f64(float64_t __p0) {
45676 float32_t __ret;
45677 __ret = (float32_t) __builtin_neon_vcvtxd_f32_f64(__p0);
45678 return __ret;
45679}
4522145680#ifdef __LITTLE_ENDIAN__
45222__ai float16x4_t vneg_f16(float16x4_t __p0) {
45223 float16x4_t __ret;
45224 __ret = -__p0;
45681__ai float32x2_t vcvtx_f32_f64(float64x2_t __p0) {
45682 float32x2_t __ret;
45683 __ret = (float32x2_t) __builtin_neon_vcvtx_f32_v((int8x16_t)__p0, 42);
4522545684 return __ret;
4522645685}
4522745686#else
45228__ai float16x4_t vneg_f16(float16x4_t __p0) {
45229 float16x4_t __ret;
45230 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
45231 __ret = -__rev0;
45232 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
45687__ai float32x2_t vcvtx_f32_f64(float64x2_t __p0) {
45688 float32x2_t __ret;
45689 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
45690 __ret = (float32x2_t) __builtin_neon_vcvtx_f32_v((int8x16_t)__rev0, 42);
45691 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
45692 return __ret;
45693}
45694__ai float32x2_t __noswap_vcvtx_f32_f64(float64x2_t __p0) {
45695 float32x2_t __ret;
45696 __ret = (float32x2_t) __builtin_neon_vcvtx_f32_v((int8x16_t)__p0, 42);
4523345697 return __ret;
4523445698}
4523545699#endif
4523645700
4523745701#ifdef __LITTLE_ENDIAN__
45238__ai float16x4_t vpadd_f16(float16x4_t __p0, float16x4_t __p1) {
45239 float16x4_t __ret;
45240 __ret = (float16x4_t) __builtin_neon_vpadd_v((int8x8_t)__p0, (int8x8_t)__p1, 8);
45702__ai float32x4_t vcvtx_high_f32_f64(float32x2_t __p0, float64x2_t __p1) {
45703 float32x4_t __ret;
45704 __ret = vcombine_f32(__p0, vcvtx_f32_f64(__p1));
4524145705 return __ret;
4524245706}
4524345707#else
45244__ai float16x4_t vpadd_f16(float16x4_t __p0, float16x4_t __p1) {
45245 float16x4_t __ret;
45246 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
45247 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
45248 __ret = (float16x4_t) __builtin_neon_vpadd_v((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
45708__ai float32x4_t vcvtx_high_f32_f64(float32x2_t __p0, float64x2_t __p1) {
45709 float32x4_t __ret;
45710 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
45711 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
45712 __ret = __noswap_vcombine_f32(__rev0, __noswap_vcvtx_f32_f64(__rev1));
4524945713 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
4525045714 return __ret;
4525145715}
4525245716#endif
4525345717
4525445718#ifdef __LITTLE_ENDIAN__
45255__ai float16x4_t vpmax_f16(float16x4_t __p0, float16x4_t __p1) {
45256 float16x4_t __ret;
45257 __ret = (float16x4_t) __builtin_neon_vpmax_v((int8x8_t)__p0, (int8x8_t)__p1, 8);
45719__ai float64x2_t vdivq_f64(float64x2_t __p0, float64x2_t __p1) {
45720 float64x2_t __ret;
45721 __ret = __p0 / __p1;
4525845722 return __ret;
4525945723}
4526045724#else
45261__ai float16x4_t vpmax_f16(float16x4_t __p0, float16x4_t __p1) {
45262 float16x4_t __ret;
45263 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
45264 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
45265 __ret = (float16x4_t) __builtin_neon_vpmax_v((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
45266 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
45725__ai float64x2_t vdivq_f64(float64x2_t __p0, float64x2_t __p1) {
45726 float64x2_t __ret;
45727 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
45728 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
45729 __ret = __rev0 / __rev1;
45730 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4526745731 return __ret;
4526845732}
4526945733#endif
4527045734
4527145735#ifdef __LITTLE_ENDIAN__
45272__ai float16x4_t vpmin_f16(float16x4_t __p0, float16x4_t __p1) {
45273 float16x4_t __ret;
45274 __ret = (float16x4_t) __builtin_neon_vpmin_v((int8x8_t)__p0, (int8x8_t)__p1, 8);
45736__ai float32x4_t vdivq_f32(float32x4_t __p0, float32x4_t __p1) {
45737 float32x4_t __ret;
45738 __ret = __p0 / __p1;
4527545739 return __ret;
4527645740}
4527745741#else
45278__ai float16x4_t vpmin_f16(float16x4_t __p0, float16x4_t __p1) {
45279 float16x4_t __ret;
45280 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
45281 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
45282 __ret = (float16x4_t) __builtin_neon_vpmin_v((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
45742__ai float32x4_t vdivq_f32(float32x4_t __p0, float32x4_t __p1) {
45743 float32x4_t __ret;
45744 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
45745 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
45746 __ret = __rev0 / __rev1;
4528345747 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
4528445748 return __ret;
4528545749}
4528645750#endif
4528745751
45752__ai float64x1_t vdiv_f64(float64x1_t __p0, float64x1_t __p1) {
45753 float64x1_t __ret;
45754 __ret = __p0 / __p1;
45755 return __ret;
45756}
4528845757#ifdef __LITTLE_ENDIAN__
45289__ai float16x8_t vrecpeq_f16(float16x8_t __p0) {
45290 float16x8_t __ret;
45291 __ret = (float16x8_t) __builtin_neon_vrecpeq_v((int8x16_t)__p0, 40);
45758__ai float32x2_t vdiv_f32(float32x2_t __p0, float32x2_t __p1) {
45759 float32x2_t __ret;
45760 __ret = __p0 / __p1;
4529245761 return __ret;
4529345762}
4529445763#else
45295__ai float16x8_t vrecpeq_f16(float16x8_t __p0) {
45296 float16x8_t __ret;
45297 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
45298 __ret = (float16x8_t) __builtin_neon_vrecpeq_v((int8x16_t)__rev0, 40);
45299 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
45764__ai float32x2_t vdiv_f32(float32x2_t __p0, float32x2_t __p1) {
45765 float32x2_t __ret;
45766 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
45767 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
45768 __ret = __rev0 / __rev1;
45769 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4530045770 return __ret;
4530145771}
4530245772#endif
4530345773
4530445774#ifdef __LITTLE_ENDIAN__
45305__ai float16x4_t vrecpe_f16(float16x4_t __p0) {
45306 float16x4_t __ret;
45307 __ret = (float16x4_t) __builtin_neon_vrecpe_v((int8x8_t)__p0, 8);
45308 return __ret;
45309}
45775#define vdupb_lane_p8(__p0, __p1) __extension__ ({ \
45776 poly8_t __ret; \
45777 poly8x8_t __s0 = __p0; \
45778 __ret = (poly8_t) __builtin_neon_vdupb_lane_i8((poly8x8_t)__s0, __p1); \
45779 __ret; \
45780})
4531045781#else
45311__ai float16x4_t vrecpe_f16(float16x4_t __p0) {
45312 float16x4_t __ret;
45313 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
45314 __ret = (float16x4_t) __builtin_neon_vrecpe_v((int8x8_t)__rev0, 8);
45315 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
45316 return __ret;
45317}
45782#define vdupb_lane_p8(__p0, __p1) __extension__ ({ \
45783 poly8_t __ret; \
45784 poly8x8_t __s0 = __p0; \
45785 poly8x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
45786 __ret = (poly8_t) __builtin_neon_vdupb_lane_i8((poly8x8_t)__rev0, __p1); \
45787 __ret; \
45788})
4531845789#endif
4531945790
4532045791#ifdef __LITTLE_ENDIAN__
45321__ai float16x8_t vrecpsq_f16(float16x8_t __p0, float16x8_t __p1) {
45322 float16x8_t __ret;
45323 __ret = (float16x8_t) __builtin_neon_vrecpsq_v((int8x16_t)__p0, (int8x16_t)__p1, 40);
45324 return __ret;
45325}
45792#define vduph_lane_p16(__p0, __p1) __extension__ ({ \
45793 poly16_t __ret; \
45794 poly16x4_t __s0 = __p0; \
45795 __ret = (poly16_t) __builtin_neon_vduph_lane_i16((poly16x4_t)__s0, __p1); \
45796 __ret; \
45797})
4532645798#else
45327__ai float16x8_t vrecpsq_f16(float16x8_t __p0, float16x8_t __p1) {
45328 float16x8_t __ret;
45329 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
45330 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
45331 __ret = (float16x8_t) __builtin_neon_vrecpsq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
45332 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
45333 return __ret;
45334}
45799#define vduph_lane_p16(__p0, __p1) __extension__ ({ \
45800 poly16_t __ret; \
45801 poly16x4_t __s0 = __p0; \
45802 poly16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
45803 __ret = (poly16_t) __builtin_neon_vduph_lane_i16((poly16x4_t)__rev0, __p1); \
45804 __ret; \
45805})
4533545806#endif
4533645807
4533745808#ifdef __LITTLE_ENDIAN__
45338__ai float16x4_t vrecps_f16(float16x4_t __p0, float16x4_t __p1) {
45339 float16x4_t __ret;
45340 __ret = (float16x4_t) __builtin_neon_vrecps_v((int8x8_t)__p0, (int8x8_t)__p1, 8);
45341 return __ret;
45342}
45809#define vdupb_lane_u8(__p0, __p1) __extension__ ({ \
45810 uint8_t __ret; \
45811 uint8x8_t __s0 = __p0; \
45812 __ret = (uint8_t) __builtin_neon_vdupb_lane_i8((int8x8_t)__s0, __p1); \
45813 __ret; \
45814})
4534345815#else
45344__ai float16x4_t vrecps_f16(float16x4_t __p0, float16x4_t __p1) {
45345 float16x4_t __ret;
45346 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
45347 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
45348 __ret = (float16x4_t) __builtin_neon_vrecps_v((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
45349 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
45350 return __ret;
45351}
45816#define vdupb_lane_u8(__p0, __p1) __extension__ ({ \
45817 uint8_t __ret; \
45818 uint8x8_t __s0 = __p0; \
45819 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
45820 __ret = (uint8_t) __builtin_neon_vdupb_lane_i8((int8x8_t)__rev0, __p1); \
45821 __ret; \
45822})
4535245823#endif
4535345824
4535445825#ifdef __LITTLE_ENDIAN__
45355__ai float16x8_t vrev64q_f16(float16x8_t __p0) {
45356 float16x8_t __ret;
45357 __ret = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0, 7, 6, 5, 4);
45358 return __ret;
45359}
45826#define vdups_lane_u32(__p0, __p1) __extension__ ({ \
45827 uint32_t __ret; \
45828 uint32x2_t __s0 = __p0; \
45829 __ret = (uint32_t) __builtin_neon_vdups_lane_i32((int32x2_t)__s0, __p1); \
45830 __ret; \
45831})
4536045832#else
45361__ai float16x8_t vrev64q_f16(float16x8_t __p0) {
45362 float16x8_t __ret;
45363 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
45364 __ret = __builtin_shufflevector(__rev0, __rev0, 3, 2, 1, 0, 7, 6, 5, 4);
45365 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
45366 return __ret;
45367}
45833#define vdups_lane_u32(__p0, __p1) __extension__ ({ \
45834 uint32_t __ret; \
45835 uint32x2_t __s0 = __p0; \
45836 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
45837 __ret = (uint32_t) __builtin_neon_vdups_lane_i32((int32x2_t)__rev0, __p1); \
45838 __ret; \
45839})
4536845840#endif
4536945841
45842#define vdupd_lane_u64(__p0, __p1) __extension__ ({ \
45843 uint64_t __ret; \
45844 uint64x1_t __s0 = __p0; \
45845 __ret = (uint64_t) __builtin_neon_vdupd_lane_i64((int64x1_t)__s0, __p1); \
45846 __ret; \
45847})
4537045848#ifdef __LITTLE_ENDIAN__
45371__ai float16x4_t vrev64_f16(float16x4_t __p0) {
45372 float16x4_t __ret;
45373 __ret = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
45374 return __ret;
45375}
45849#define vduph_lane_u16(__p0, __p1) __extension__ ({ \
45850 uint16_t __ret; \
45851 uint16x4_t __s0 = __p0; \
45852 __ret = (uint16_t) __builtin_neon_vduph_lane_i16((int16x4_t)__s0, __p1); \
45853 __ret; \
45854})
4537645855#else
45377__ai float16x4_t vrev64_f16(float16x4_t __p0) {
45378 float16x4_t __ret;
45379 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
45380 __ret = __builtin_shufflevector(__rev0, __rev0, 3, 2, 1, 0);
45381 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
45382 return __ret;
45383}
45856#define vduph_lane_u16(__p0, __p1) __extension__ ({ \
45857 uint16_t __ret; \
45858 uint16x4_t __s0 = __p0; \
45859 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
45860 __ret = (uint16_t) __builtin_neon_vduph_lane_i16((int16x4_t)__rev0, __p1); \
45861 __ret; \
45862})
4538445863#endif
4538545864
4538645865#ifdef __LITTLE_ENDIAN__
45387__ai float16x8_t vrsqrteq_f16(float16x8_t __p0) {
45388 float16x8_t __ret;
45389 __ret = (float16x8_t) __builtin_neon_vrsqrteq_v((int8x16_t)__p0, 40);
45390 return __ret;
45391}
45866#define vdupb_lane_s8(__p0, __p1) __extension__ ({ \
45867 int8_t __ret; \
45868 int8x8_t __s0 = __p0; \
45869 __ret = (int8_t) __builtin_neon_vdupb_lane_i8((int8x8_t)__s0, __p1); \
45870 __ret; \
45871})
4539245872#else
45393__ai float16x8_t vrsqrteq_f16(float16x8_t __p0) {
45394 float16x8_t __ret;
45395 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
45396 __ret = (float16x8_t) __builtin_neon_vrsqrteq_v((int8x16_t)__rev0, 40);
45397 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
45398 return __ret;
45399}
45873#define vdupb_lane_s8(__p0, __p1) __extension__ ({ \
45874 int8_t __ret; \
45875 int8x8_t __s0 = __p0; \
45876 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
45877 __ret = (int8_t) __builtin_neon_vdupb_lane_i8((int8x8_t)__rev0, __p1); \
45878 __ret; \
45879})
4540045880#endif
4540145881
45882#define vdupd_lane_f64(__p0, __p1) __extension__ ({ \
45883 float64_t __ret; \
45884 float64x1_t __s0 = __p0; \
45885 __ret = (float64_t) __builtin_neon_vdupd_lane_f64((float64x1_t)__s0, __p1); \
45886 __ret; \
45887})
4540245888#ifdef __LITTLE_ENDIAN__
45403__ai float16x4_t vrsqrte_f16(float16x4_t __p0) {
45404 float16x4_t __ret;
45405 __ret = (float16x4_t) __builtin_neon_vrsqrte_v((int8x8_t)__p0, 8);
45406 return __ret;
45407}
45889#define vdups_lane_f32(__p0, __p1) __extension__ ({ \
45890 float32_t __ret; \
45891 float32x2_t __s0 = __p0; \
45892 __ret = (float32_t) __builtin_neon_vdups_lane_f32((float32x2_t)__s0, __p1); \
45893 __ret; \
45894})
4540845895#else
45409__ai float16x4_t vrsqrte_f16(float16x4_t __p0) {
45410 float16x4_t __ret;
45411 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
45412 __ret = (float16x4_t) __builtin_neon_vrsqrte_v((int8x8_t)__rev0, 8);
45413 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
45414 return __ret;
45415}
45896#define vdups_lane_f32(__p0, __p1) __extension__ ({ \
45897 float32_t __ret; \
45898 float32x2_t __s0 = __p0; \
45899 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
45900 __ret = (float32_t) __builtin_neon_vdups_lane_f32((float32x2_t)__rev0, __p1); \
45901 __ret; \
45902})
45903#endif
45904
45905#ifdef __LITTLE_ENDIAN__
45906#define vdups_lane_s32(__p0, __p1) __extension__ ({ \
45907 int32_t __ret; \
45908 int32x2_t __s0 = __p0; \
45909 __ret = (int32_t) __builtin_neon_vdups_lane_i32((int32x2_t)__s0, __p1); \
45910 __ret; \
45911})
45912#else
45913#define vdups_lane_s32(__p0, __p1) __extension__ ({ \
45914 int32_t __ret; \
45915 int32x2_t __s0 = __p0; \
45916 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
45917 __ret = (int32_t) __builtin_neon_vdups_lane_i32((int32x2_t)__rev0, __p1); \
45918 __ret; \
45919})
4541645920#endif
4541745921
45922#define vdupd_lane_s64(__p0, __p1) __extension__ ({ \
45923 int64_t __ret; \
45924 int64x1_t __s0 = __p0; \
45925 __ret = (int64_t) __builtin_neon_vdupd_lane_i64((int64x1_t)__s0, __p1); \
45926 __ret; \
45927})
4541845928#ifdef __LITTLE_ENDIAN__
45419__ai float16x8_t vrsqrtsq_f16(float16x8_t __p0, float16x8_t __p1) {
45420 float16x8_t __ret;
45421 __ret = (float16x8_t) __builtin_neon_vrsqrtsq_v((int8x16_t)__p0, (int8x16_t)__p1, 40);
45422 return __ret;
45423}
45929#define vduph_lane_s16(__p0, __p1) __extension__ ({ \
45930 int16_t __ret; \
45931 int16x4_t __s0 = __p0; \
45932 __ret = (int16_t) __builtin_neon_vduph_lane_i16((int16x4_t)__s0, __p1); \
45933 __ret; \
45934})
4542445935#else
45425__ai float16x8_t vrsqrtsq_f16(float16x8_t __p0, float16x8_t __p1) {
45426 float16x8_t __ret;
45427 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
45428 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
45429 __ret = (float16x8_t) __builtin_neon_vrsqrtsq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
45430 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
45431 return __ret;
45432}
45936#define vduph_lane_s16(__p0, __p1) __extension__ ({ \
45937 int16_t __ret; \
45938 int16x4_t __s0 = __p0; \
45939 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
45940 __ret = (int16_t) __builtin_neon_vduph_lane_i16((int16x4_t)__rev0, __p1); \
45941 __ret; \
45942})
4543345943#endif
4543445944
45945#define vdup_lane_p64(__p0_343, __p1_343) __extension__ ({ \
45946 poly64x1_t __ret_343; \
45947 poly64x1_t __s0_343 = __p0_343; \
45948 __ret_343 = splat_lane_p64(__s0_343, __p1_343); \
45949 __ret_343; \
45950})
4543545951#ifdef __LITTLE_ENDIAN__
45436__ai float16x4_t vrsqrts_f16(float16x4_t __p0, float16x4_t __p1) {
45437 float16x4_t __ret;
45438 __ret = (float16x4_t) __builtin_neon_vrsqrts_v((int8x8_t)__p0, (int8x8_t)__p1, 8);
45439 return __ret;
45440}
45952#define vdupq_lane_p64(__p0_344, __p1_344) __extension__ ({ \
45953 poly64x2_t __ret_344; \
45954 poly64x1_t __s0_344 = __p0_344; \
45955 __ret_344 = splatq_lane_p64(__s0_344, __p1_344); \
45956 __ret_344; \
45957})
4544145958#else
45442__ai float16x4_t vrsqrts_f16(float16x4_t __p0, float16x4_t __p1) {
45443 float16x4_t __ret;
45444 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
45445 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
45446 __ret = (float16x4_t) __builtin_neon_vrsqrts_v((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
45447 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
45448 return __ret;
45449}
45959#define vdupq_lane_p64(__p0_345, __p1_345) __extension__ ({ \
45960 poly64x2_t __ret_345; \
45961 poly64x1_t __s0_345 = __p0_345; \
45962 __ret_345 = __noswap_splatq_lane_p64(__s0_345, __p1_345); \
45963 __ret_345 = __builtin_shufflevector(__ret_345, __ret_345, 1, 0); \
45964 __ret_345; \
45965})
4545045966#endif
4545145967
4545245968#ifdef __LITTLE_ENDIAN__
45453__ai float16x8_t vsubq_f16(float16x8_t __p0, float16x8_t __p1) {
45454 float16x8_t __ret;
45455 __ret = __p0 - __p1;
45456 return __ret;
45457}
45969#define vdupq_lane_f64(__p0_346, __p1_346) __extension__ ({ \
45970 float64x2_t __ret_346; \
45971 float64x1_t __s0_346 = __p0_346; \
45972 __ret_346 = splatq_lane_f64(__s0_346, __p1_346); \
45973 __ret_346; \
45974})
4545845975#else
45459__ai float16x8_t vsubq_f16(float16x8_t __p0, float16x8_t __p1) {
45460 float16x8_t __ret;
45461 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
45462 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
45463 __ret = __rev0 - __rev1;
45464 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
45465 return __ret;
45466}
45976#define vdupq_lane_f64(__p0_347, __p1_347) __extension__ ({ \
45977 float64x2_t __ret_347; \
45978 float64x1_t __s0_347 = __p0_347; \
45979 __ret_347 = __noswap_splatq_lane_f64(__s0_347, __p1_347); \
45980 __ret_347 = __builtin_shufflevector(__ret_347, __ret_347, 1, 0); \
45981 __ret_347; \
45982})
4546745983#endif
4546845984
45985#define vdup_lane_f64(__p0_348, __p1_348) __extension__ ({ \
45986 float64x1_t __ret_348; \
45987 float64x1_t __s0_348 = __p0_348; \
45988 __ret_348 = splat_lane_f64(__s0_348, __p1_348); \
45989 __ret_348; \
45990})
4546945991#ifdef __LITTLE_ENDIAN__
45470__ai float16x4_t vsub_f16(float16x4_t __p0, float16x4_t __p1) {
45471 float16x4_t __ret;
45472 __ret = __p0 - __p1;
45473 return __ret;
45474}
45992#define vdupb_laneq_p8(__p0, __p1) __extension__ ({ \
45993 poly8_t __ret; \
45994 poly8x16_t __s0 = __p0; \
45995 __ret = (poly8_t) __builtin_neon_vdupb_laneq_i8((poly8x16_t)__s0, __p1); \
45996 __ret; \
45997})
4547545998#else
45476__ai float16x4_t vsub_f16(float16x4_t __p0, float16x4_t __p1) {
45477 float16x4_t __ret;
45478 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
45479 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
45480 __ret = __rev0 - __rev1;
45481 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
45482 return __ret;
45483}
45999#define vdupb_laneq_p8(__p0, __p1) __extension__ ({ \
46000 poly8_t __ret; \
46001 poly8x16_t __s0 = __p0; \
46002 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
46003 __ret = (poly8_t) __builtin_neon_vdupb_laneq_i8((poly8x16_t)__rev0, __p1); \
46004 __ret; \
46005})
4548446006#endif
4548546007
4548646008#ifdef __LITTLE_ENDIAN__
45487__ai float16x8x2_t vtrnq_f16(float16x8_t __p0, float16x8_t __p1) {
45488 float16x8x2_t __ret;
45489 __builtin_neon_vtrnq_v(&__ret, (int8x16_t)__p0, (int8x16_t)__p1, 40);
45490 return __ret;
45491}
46009#define vduph_laneq_p16(__p0, __p1) __extension__ ({ \
46010 poly16_t __ret; \
46011 poly16x8_t __s0 = __p0; \
46012 __ret = (poly16_t) __builtin_neon_vduph_laneq_i16((poly16x8_t)__s0, __p1); \
46013 __ret; \
46014})
4549246015#else
45493__ai float16x8x2_t vtrnq_f16(float16x8_t __p0, float16x8_t __p1) {
45494 float16x8x2_t __ret;
45495 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
45496 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
45497 __builtin_neon_vtrnq_v(&__ret, (int8x16_t)__rev0, (int8x16_t)__rev1, 40);
45498
45499 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0);
45500 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0);
45501 return __ret;
45502}
46016#define vduph_laneq_p16(__p0, __p1) __extension__ ({ \
46017 poly16_t __ret; \
46018 poly16x8_t __s0 = __p0; \
46019 poly16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
46020 __ret = (poly16_t) __builtin_neon_vduph_laneq_i16((poly16x8_t)__rev0, __p1); \
46021 __ret; \
46022})
4550346023#endif
4550446024
4550546025#ifdef __LITTLE_ENDIAN__
45506__ai float16x4x2_t vtrn_f16(float16x4_t __p0, float16x4_t __p1) {
45507 float16x4x2_t __ret;
45508 __builtin_neon_vtrn_v(&__ret, (int8x8_t)__p0, (int8x8_t)__p1, 8);
45509 return __ret;
45510}
46026#define vdupb_laneq_u8(__p0, __p1) __extension__ ({ \
46027 uint8_t __ret; \
46028 uint8x16_t __s0 = __p0; \
46029 __ret = (uint8_t) __builtin_neon_vdupb_laneq_i8((int8x16_t)__s0, __p1); \
46030 __ret; \
46031})
4551146032#else
45512__ai float16x4x2_t vtrn_f16(float16x4_t __p0, float16x4_t __p1) {
45513 float16x4x2_t __ret;
45514 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
45515 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
45516 __builtin_neon_vtrn_v(&__ret, (int8x8_t)__rev0, (int8x8_t)__rev1, 8);
45517
45518 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0);
45519 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0);
45520 return __ret;
45521}
46033#define vdupb_laneq_u8(__p0, __p1) __extension__ ({ \
46034 uint8_t __ret; \
46035 uint8x16_t __s0 = __p0; \
46036 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
46037 __ret = (uint8_t) __builtin_neon_vdupb_laneq_i8((int8x16_t)__rev0, __p1); \
46038 __ret; \
46039})
4552246040#endif
4552346041
4552446042#ifdef __LITTLE_ENDIAN__
45525__ai float16x8x2_t vuzpq_f16(float16x8_t __p0, float16x8_t __p1) {
45526 float16x8x2_t __ret;
45527 __builtin_neon_vuzpq_v(&__ret, (int8x16_t)__p0, (int8x16_t)__p1, 40);
45528 return __ret;
45529}
46043#define vdups_laneq_u32(__p0, __p1) __extension__ ({ \
46044 uint32_t __ret; \
46045 uint32x4_t __s0 = __p0; \
46046 __ret = (uint32_t) __builtin_neon_vdups_laneq_i32((int32x4_t)__s0, __p1); \
46047 __ret; \
46048})
4553046049#else
45531__ai float16x8x2_t vuzpq_f16(float16x8_t __p0, float16x8_t __p1) {
45532 float16x8x2_t __ret;
45533 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
45534 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
45535 __builtin_neon_vuzpq_v(&__ret, (int8x16_t)__rev0, (int8x16_t)__rev1, 40);
45536
45537 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0);
45538 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0);
45539 return __ret;
45540}
46050#define vdups_laneq_u32(__p0, __p1) __extension__ ({ \
46051 uint32_t __ret; \
46052 uint32x4_t __s0 = __p0; \
46053 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
46054 __ret = (uint32_t) __builtin_neon_vdups_laneq_i32((int32x4_t)__rev0, __p1); \
46055 __ret; \
46056})
4554146057#endif
4554246058
4554346059#ifdef __LITTLE_ENDIAN__
45544__ai float16x4x2_t vuzp_f16(float16x4_t __p0, float16x4_t __p1) {
45545 float16x4x2_t __ret;
45546 __builtin_neon_vuzp_v(&__ret, (int8x8_t)__p0, (int8x8_t)__p1, 8);
45547 return __ret;
45548}
46060#define vdupd_laneq_u64(__p0, __p1) __extension__ ({ \
46061 uint64_t __ret; \
46062 uint64x2_t __s0 = __p0; \
46063 __ret = (uint64_t) __builtin_neon_vdupd_laneq_i64((int64x2_t)__s0, __p1); \
46064 __ret; \
46065})
4554946066#else
45550__ai float16x4x2_t vuzp_f16(float16x4_t __p0, float16x4_t __p1) {
45551 float16x4x2_t __ret;
45552 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
45553 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
45554 __builtin_neon_vuzp_v(&__ret, (int8x8_t)__rev0, (int8x8_t)__rev1, 8);
45555
45556 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0);
45557 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0);
45558 return __ret;
45559}
46067#define vdupd_laneq_u64(__p0, __p1) __extension__ ({ \
46068 uint64_t __ret; \
46069 uint64x2_t __s0 = __p0; \
46070 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
46071 __ret = (uint64_t) __builtin_neon_vdupd_laneq_i64((int64x2_t)__rev0, __p1); \
46072 __ret; \
46073})
4556046074#endif
4556146075
4556246076#ifdef __LITTLE_ENDIAN__
45563__ai float16x8x2_t vzipq_f16(float16x8_t __p0, float16x8_t __p1) {
45564 float16x8x2_t __ret;
45565 __builtin_neon_vzipq_v(&__ret, (int8x16_t)__p0, (int8x16_t)__p1, 40);
45566 return __ret;
45567}
46077#define vduph_laneq_u16(__p0, __p1) __extension__ ({ \
46078 uint16_t __ret; \
46079 uint16x8_t __s0 = __p0; \
46080 __ret = (uint16_t) __builtin_neon_vduph_laneq_i16((int16x8_t)__s0, __p1); \
46081 __ret; \
46082})
4556846083#else
45569__ai float16x8x2_t vzipq_f16(float16x8_t __p0, float16x8_t __p1) {
45570 float16x8x2_t __ret;
45571 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
45572 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
45573 __builtin_neon_vzipq_v(&__ret, (int8x16_t)__rev0, (int8x16_t)__rev1, 40);
45574
45575 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 7, 6, 5, 4, 3, 2, 1, 0);
45576 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 7, 6, 5, 4, 3, 2, 1, 0);
45577 return __ret;
45578}
46084#define vduph_laneq_u16(__p0, __p1) __extension__ ({ \
46085 uint16_t __ret; \
46086 uint16x8_t __s0 = __p0; \
46087 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
46088 __ret = (uint16_t) __builtin_neon_vduph_laneq_i16((int16x8_t)__rev0, __p1); \
46089 __ret; \
46090})
4557946091#endif
4558046092
4558146093#ifdef __LITTLE_ENDIAN__
45582__ai float16x4x2_t vzip_f16(float16x4_t __p0, float16x4_t __p1) {
45583 float16x4x2_t __ret;
45584 __builtin_neon_vzip_v(&__ret, (int8x8_t)__p0, (int8x8_t)__p1, 8);
45585 return __ret;
45586}
46094#define vdupb_laneq_s8(__p0, __p1) __extension__ ({ \
46095 int8_t __ret; \
46096 int8x16_t __s0 = __p0; \
46097 __ret = (int8_t) __builtin_neon_vdupb_laneq_i8((int8x16_t)__s0, __p1); \
46098 __ret; \
46099})
4558746100#else
45588__ai float16x4x2_t vzip_f16(float16x4_t __p0, float16x4_t __p1) {
45589 float16x4x2_t __ret;
45590 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
45591 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
45592 __builtin_neon_vzip_v(&__ret, (int8x8_t)__rev0, (int8x8_t)__rev1, 8);
45593
45594 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 3, 2, 1, 0);
45595 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 3, 2, 1, 0);
45596 return __ret;
45597}
46101#define vdupb_laneq_s8(__p0, __p1) __extension__ ({ \
46102 int8_t __ret; \
46103 int8x16_t __s0 = __p0; \
46104 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
46105 __ret = (int8_t) __builtin_neon_vdupb_laneq_i8((int8x16_t)__rev0, __p1); \
46106 __ret; \
46107})
4559846108#endif
4559946109
45600#endif
45601#if defined(__ARM_FEATURE_FP16_VECTOR_ARITHMETIC) && defined(__aarch64__)
4560246110#ifdef __LITTLE_ENDIAN__
45603__ai float16x8_t vdivq_f16(float16x8_t __p0, float16x8_t __p1) {
45604 float16x8_t __ret;
45605 __ret = __p0 / __p1;
45606 return __ret;
45607}
46111#define vdupd_laneq_f64(__p0, __p1) __extension__ ({ \
46112 float64_t __ret; \
46113 float64x2_t __s0 = __p0; \
46114 __ret = (float64_t) __builtin_neon_vdupd_laneq_f64((float64x2_t)__s0, __p1); \
46115 __ret; \
46116})
4560846117#else
45609__ai float16x8_t vdivq_f16(float16x8_t __p0, float16x8_t __p1) {
45610 float16x8_t __ret;
45611 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
45612 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
45613 __ret = __rev0 / __rev1;
45614 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
45615 return __ret;
45616}
46118#define vdupd_laneq_f64(__p0, __p1) __extension__ ({ \
46119 float64_t __ret; \
46120 float64x2_t __s0 = __p0; \
46121 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
46122 __ret = (float64_t) __builtin_neon_vdupd_laneq_f64((float64x2_t)__rev0, __p1); \
46123 __ret; \
46124})
4561746125#endif
4561846126
4561946127#ifdef __LITTLE_ENDIAN__
45620__ai float16x4_t vdiv_f16(float16x4_t __p0, float16x4_t __p1) {
45621 float16x4_t __ret;
45622 __ret = __p0 / __p1;
45623 return __ret;
45624}
46128#define vdups_laneq_f32(__p0, __p1) __extension__ ({ \
46129 float32_t __ret; \
46130 float32x4_t __s0 = __p0; \
46131 __ret = (float32_t) __builtin_neon_vdups_laneq_f32((float32x4_t)__s0, __p1); \
46132 __ret; \
46133})
4562546134#else
45626__ai float16x4_t vdiv_f16(float16x4_t __p0, float16x4_t __p1) {
45627 float16x4_t __ret;
45628 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
45629 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
45630 __ret = __rev0 / __rev1;
45631 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
45632 return __ret;
45633}
46135#define vdups_laneq_f32(__p0, __p1) __extension__ ({ \
46136 float32_t __ret; \
46137 float32x4_t __s0 = __p0; \
46138 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
46139 __ret = (float32_t) __builtin_neon_vdups_laneq_f32((float32x4_t)__rev0, __p1); \
46140 __ret; \
46141})
4563446142#endif
4563546143
4563646144#ifdef __LITTLE_ENDIAN__
45637#define vduph_lane_f16(__p0, __p1) __extension__ ({ \
45638 float16_t __ret; \
45639 float16x4_t __s0 = __p0; \
45640 __ret = (float16_t) __builtin_neon_vduph_lane_f16((float16x4_t)__s0, __p1); \
46145#define vdups_laneq_s32(__p0, __p1) __extension__ ({ \
46146 int32_t __ret; \
46147 int32x4_t __s0 = __p0; \
46148 __ret = (int32_t) __builtin_neon_vdups_laneq_i32((int32x4_t)__s0, __p1); \
4564146149 __ret; \
4564246150})
4564346151#else
45644#define vduph_lane_f16(__p0, __p1) __extension__ ({ \
45645 float16_t __ret; \
45646 float16x4_t __s0 = __p0; \
45647 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
45648 __ret = (float16_t) __builtin_neon_vduph_lane_f16((float16x4_t)__rev0, __p1); \
46152#define vdups_laneq_s32(__p0, __p1) __extension__ ({ \
46153 int32_t __ret; \
46154 int32x4_t __s0 = __p0; \
46155 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
46156 __ret = (int32_t) __builtin_neon_vdups_laneq_i32((int32x4_t)__rev0, __p1); \
4564946157 __ret; \
4565046158})
4565146159#endif
4565246160
4565346161#ifdef __LITTLE_ENDIAN__
45654#define vduph_laneq_f16(__p0, __p1) __extension__ ({ \
45655 float16_t __ret; \
45656 float16x8_t __s0 = __p0; \
45657 __ret = (float16_t) __builtin_neon_vduph_laneq_f16((float16x8_t)__s0, __p1); \
46162#define vdupd_laneq_s64(__p0, __p1) __extension__ ({ \
46163 int64_t __ret; \
46164 int64x2_t __s0 = __p0; \
46165 __ret = (int64_t) __builtin_neon_vdupd_laneq_i64((int64x2_t)__s0, __p1); \
4565846166 __ret; \
4565946167})
4566046168#else
45661#define vduph_laneq_f16(__p0, __p1) __extension__ ({ \
45662 float16_t __ret; \
45663 float16x8_t __s0 = __p0; \
45664 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
45665 __ret = (float16_t) __builtin_neon_vduph_laneq_f16((float16x8_t)__rev0, __p1); \
46169#define vdupd_laneq_s64(__p0, __p1) __extension__ ({ \
46170 int64_t __ret; \
46171 int64x2_t __s0 = __p0; \
46172 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
46173 __ret = (int64_t) __builtin_neon_vdupd_laneq_i64((int64x2_t)__rev0, __p1); \
4566646174 __ret; \
4566746175})
4566846176#endif
4566946177
4567046178#ifdef __LITTLE_ENDIAN__
45671#define vfmah_lane_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
45672 float16_t __ret; \
45673 float16_t __s0 = __p0; \
45674 float16_t __s1 = __p1; \
45675 float16x4_t __s2 = __p2; \
45676 __ret = (float16_t) __builtin_neon_vfmah_lane_f16(__s0, __s1, (float16x4_t)__s2, __p3); \
46179#define vduph_laneq_s16(__p0, __p1) __extension__ ({ \
46180 int16_t __ret; \
46181 int16x8_t __s0 = __p0; \
46182 __ret = (int16_t) __builtin_neon_vduph_laneq_i16((int16x8_t)__s0, __p1); \
4567746183 __ret; \
4567846184})
4567946185#else
45680#define vfmah_lane_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
45681 float16_t __ret; \
45682 float16_t __s0 = __p0; \
45683 float16_t __s1 = __p1; \
45684 float16x4_t __s2 = __p2; \
45685 float16x4_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 3, 2, 1, 0); \
45686 __ret = (float16_t) __builtin_neon_vfmah_lane_f16(__s0, __s1, (float16x4_t)__rev2, __p3); \
45687 __ret; \
45688})
45689#define __noswap_vfmah_lane_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
45690 float16_t __ret; \
45691 float16_t __s0 = __p0; \
45692 float16_t __s1 = __p1; \
45693 float16x4_t __s2 = __p2; \
45694 __ret = (float16_t) __builtin_neon_vfmah_lane_f16(__s0, __s1, (float16x4_t)__s2, __p3); \
46186#define vduph_laneq_s16(__p0, __p1) __extension__ ({ \
46187 int16_t __ret; \
46188 int16x8_t __s0 = __p0; \
46189 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
46190 __ret = (int16_t) __builtin_neon_vduph_laneq_i16((int16x8_t)__rev0, __p1); \
4569546191 __ret; \
4569646192})
4569746193#endif
4569846194
4569946195#ifdef __LITTLE_ENDIAN__
45700#define vfmaq_lane_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
45701 float16x8_t __ret; \
45702 float16x8_t __s0 = __p0; \
45703 float16x8_t __s1 = __p1; \
45704 float16x4_t __s2 = __p2; \
45705 __ret = (float16x8_t) __builtin_neon_vfmaq_lane_v((int8x16_t)__s0, (int8x16_t)__s1, (int8x8_t)__s2, __p3, 40); \
45706 __ret; \
46196#define vdup_laneq_p8(__p0_349, __p1_349) __extension__ ({ \
46197 poly8x8_t __ret_349; \
46198 poly8x16_t __s0_349 = __p0_349; \
46199 __ret_349 = splat_laneq_p8(__s0_349, __p1_349); \
46200 __ret_349; \
4570746201})
4570846202#else
45709#define vfmaq_lane_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
45710 float16x8_t __ret; \
45711 float16x8_t __s0 = __p0; \
45712 float16x8_t __s1 = __p1; \
45713 float16x4_t __s2 = __p2; \
45714 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
45715 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
45716 float16x4_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 3, 2, 1, 0); \
45717 __ret = (float16x8_t) __builtin_neon_vfmaq_lane_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x8_t)__rev2, __p3, 40); \
45718 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
45719 __ret; \
45720})
45721#define __noswap_vfmaq_lane_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
45722 float16x8_t __ret; \
45723 float16x8_t __s0 = __p0; \
45724 float16x8_t __s1 = __p1; \
45725 float16x4_t __s2 = __p2; \
45726 __ret = (float16x8_t) __builtin_neon_vfmaq_lane_v((int8x16_t)__s0, (int8x16_t)__s1, (int8x8_t)__s2, __p3, 40); \
45727 __ret; \
46203#define vdup_laneq_p8(__p0_350, __p1_350) __extension__ ({ \
46204 poly8x8_t __ret_350; \
46205 poly8x16_t __s0_350 = __p0_350; \
46206 poly8x16_t __rev0_350; __rev0_350 = __builtin_shufflevector(__s0_350, __s0_350, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
46207 __ret_350 = __noswap_splat_laneq_p8(__rev0_350, __p1_350); \
46208 __ret_350 = __builtin_shufflevector(__ret_350, __ret_350, 7, 6, 5, 4, 3, 2, 1, 0); \
46209 __ret_350; \
4572846210})
4572946211#endif
4573046212
4573146213#ifdef __LITTLE_ENDIAN__
45732#define vfma_lane_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
45733 float16x4_t __ret; \
45734 float16x4_t __s0 = __p0; \
45735 float16x4_t __s1 = __p1; \
45736 float16x4_t __s2 = __p2; \
45737 __ret = (float16x4_t) __builtin_neon_vfma_lane_v((int8x8_t)__s0, (int8x8_t)__s1, (int8x8_t)__s2, __p3, 8); \
45738 __ret; \
46214#define vdup_laneq_p64(__p0_351, __p1_351) __extension__ ({ \
46215 poly64x1_t __ret_351; \
46216 poly64x2_t __s0_351 = __p0_351; \
46217 __ret_351 = splat_laneq_p64(__s0_351, __p1_351); \
46218 __ret_351; \
4573946219})
4574046220#else
45741#define vfma_lane_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
45742 float16x4_t __ret; \
45743 float16x4_t __s0 = __p0; \
45744 float16x4_t __s1 = __p1; \
45745 float16x4_t __s2 = __p2; \
45746 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
45747 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
45748 float16x4_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 3, 2, 1, 0); \
45749 __ret = (float16x4_t) __builtin_neon_vfma_lane_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, __p3, 8); \
45750 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
45751 __ret; \
46221#define vdup_laneq_p64(__p0_352, __p1_352) __extension__ ({ \
46222 poly64x1_t __ret_352; \
46223 poly64x2_t __s0_352 = __p0_352; \
46224 poly64x2_t __rev0_352; __rev0_352 = __builtin_shufflevector(__s0_352, __s0_352, 1, 0); \
46225 __ret_352 = __noswap_splat_laneq_p64(__rev0_352, __p1_352); \
46226 __ret_352; \
4575246227})
45753#define __noswap_vfma_lane_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
45754 float16x4_t __ret; \
45755 float16x4_t __s0 = __p0; \
45756 float16x4_t __s1 = __p1; \
45757 float16x4_t __s2 = __p2; \
45758 __ret = (float16x4_t) __builtin_neon_vfma_lane_v((int8x8_t)__s0, (int8x8_t)__s1, (int8x8_t)__s2, __p3, 8); \
45759 __ret; \
46228#endif
46229
46230#ifdef __LITTLE_ENDIAN__
46231#define vdup_laneq_p16(__p0_353, __p1_353) __extension__ ({ \
46232 poly16x4_t __ret_353; \
46233 poly16x8_t __s0_353 = __p0_353; \
46234 __ret_353 = splat_laneq_p16(__s0_353, __p1_353); \
46235 __ret_353; \
46236})
46237#else
46238#define vdup_laneq_p16(__p0_354, __p1_354) __extension__ ({ \
46239 poly16x4_t __ret_354; \
46240 poly16x8_t __s0_354 = __p0_354; \
46241 poly16x8_t __rev0_354; __rev0_354 = __builtin_shufflevector(__s0_354, __s0_354, 7, 6, 5, 4, 3, 2, 1, 0); \
46242 __ret_354 = __noswap_splat_laneq_p16(__rev0_354, __p1_354); \
46243 __ret_354 = __builtin_shufflevector(__ret_354, __ret_354, 3, 2, 1, 0); \
46244 __ret_354; \
4576046245})
4576146246#endif
4576246247
4576346248#ifdef __LITTLE_ENDIAN__
45764#define vfmah_laneq_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
45765 float16_t __ret; \
45766 float16_t __s0 = __p0; \
45767 float16_t __s1 = __p1; \
45768 float16x8_t __s2 = __p2; \
45769 __ret = (float16_t) __builtin_neon_vfmah_laneq_f16(__s0, __s1, (float16x8_t)__s2, __p3); \
45770 __ret; \
46249#define vdupq_laneq_p8(__p0_355, __p1_355) __extension__ ({ \
46250 poly8x16_t __ret_355; \
46251 poly8x16_t __s0_355 = __p0_355; \
46252 __ret_355 = splatq_laneq_p8(__s0_355, __p1_355); \
46253 __ret_355; \
4577146254})
4577246255#else
45773#define vfmah_laneq_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
45774 float16_t __ret; \
45775 float16_t __s0 = __p0; \
45776 float16_t __s1 = __p1; \
45777 float16x8_t __s2 = __p2; \
45778 float16x8_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 7, 6, 5, 4, 3, 2, 1, 0); \
45779 __ret = (float16_t) __builtin_neon_vfmah_laneq_f16(__s0, __s1, (float16x8_t)__rev2, __p3); \
45780 __ret; \
46256#define vdupq_laneq_p8(__p0_356, __p1_356) __extension__ ({ \
46257 poly8x16_t __ret_356; \
46258 poly8x16_t __s0_356 = __p0_356; \
46259 poly8x16_t __rev0_356; __rev0_356 = __builtin_shufflevector(__s0_356, __s0_356, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
46260 __ret_356 = __noswap_splatq_laneq_p8(__rev0_356, __p1_356); \
46261 __ret_356 = __builtin_shufflevector(__ret_356, __ret_356, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
46262 __ret_356; \
4578146263})
45782#define __noswap_vfmah_laneq_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
45783 float16_t __ret; \
45784 float16_t __s0 = __p0; \
45785 float16_t __s1 = __p1; \
45786 float16x8_t __s2 = __p2; \
45787 __ret = (float16_t) __builtin_neon_vfmah_laneq_f16(__s0, __s1, (float16x8_t)__s2, __p3); \
45788 __ret; \
46264#endif
46265
46266#ifdef __LITTLE_ENDIAN__
46267#define vdupq_laneq_p64(__p0_357, __p1_357) __extension__ ({ \
46268 poly64x2_t __ret_357; \
46269 poly64x2_t __s0_357 = __p0_357; \
46270 __ret_357 = splatq_laneq_p64(__s0_357, __p1_357); \
46271 __ret_357; \
46272})
46273#else
46274#define vdupq_laneq_p64(__p0_358, __p1_358) __extension__ ({ \
46275 poly64x2_t __ret_358; \
46276 poly64x2_t __s0_358 = __p0_358; \
46277 poly64x2_t __rev0_358; __rev0_358 = __builtin_shufflevector(__s0_358, __s0_358, 1, 0); \
46278 __ret_358 = __noswap_splatq_laneq_p64(__rev0_358, __p1_358); \
46279 __ret_358 = __builtin_shufflevector(__ret_358, __ret_358, 1, 0); \
46280 __ret_358; \
4578946281})
4579046282#endif
4579146283
4579246284#ifdef __LITTLE_ENDIAN__
45793#define vfmaq_laneq_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
45794 float16x8_t __ret; \
45795 float16x8_t __s0 = __p0; \
45796 float16x8_t __s1 = __p1; \
45797 float16x8_t __s2 = __p2; \
45798 __ret = (float16x8_t) __builtin_neon_vfmaq_laneq_v((int8x16_t)__s0, (int8x16_t)__s1, (int8x16_t)__s2, __p3, 40); \
45799 __ret; \
46285#define vdupq_laneq_p16(__p0_359, __p1_359) __extension__ ({ \
46286 poly16x8_t __ret_359; \
46287 poly16x8_t __s0_359 = __p0_359; \
46288 __ret_359 = splatq_laneq_p16(__s0_359, __p1_359); \
46289 __ret_359; \
4580046290})
4580146291#else
45802#define vfmaq_laneq_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
45803 float16x8_t __ret; \
45804 float16x8_t __s0 = __p0; \
45805 float16x8_t __s1 = __p1; \
45806 float16x8_t __s2 = __p2; \
45807 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
45808 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
45809 float16x8_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 7, 6, 5, 4, 3, 2, 1, 0); \
45810 __ret = (float16x8_t) __builtin_neon_vfmaq_laneq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, __p3, 40); \
45811 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
45812 __ret; \
46292#define vdupq_laneq_p16(__p0_360, __p1_360) __extension__ ({ \
46293 poly16x8_t __ret_360; \
46294 poly16x8_t __s0_360 = __p0_360; \
46295 poly16x8_t __rev0_360; __rev0_360 = __builtin_shufflevector(__s0_360, __s0_360, 7, 6, 5, 4, 3, 2, 1, 0); \
46296 __ret_360 = __noswap_splatq_laneq_p16(__rev0_360, __p1_360); \
46297 __ret_360 = __builtin_shufflevector(__ret_360, __ret_360, 7, 6, 5, 4, 3, 2, 1, 0); \
46298 __ret_360; \
4581346299})
45814#define __noswap_vfmaq_laneq_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
45815 float16x8_t __ret; \
45816 float16x8_t __s0 = __p0; \
45817 float16x8_t __s1 = __p1; \
45818 float16x8_t __s2 = __p2; \
45819 __ret = (float16x8_t) __builtin_neon_vfmaq_laneq_v((int8x16_t)__s0, (int8x16_t)__s1, (int8x16_t)__s2, __p3, 40); \
45820 __ret; \
46300#endif
46301
46302#ifdef __LITTLE_ENDIAN__
46303#define vdupq_laneq_u8(__p0_361, __p1_361) __extension__ ({ \
46304 uint8x16_t __ret_361; \
46305 uint8x16_t __s0_361 = __p0_361; \
46306 __ret_361 = splatq_laneq_u8(__s0_361, __p1_361); \
46307 __ret_361; \
46308})
46309#else
46310#define vdupq_laneq_u8(__p0_362, __p1_362) __extension__ ({ \
46311 uint8x16_t __ret_362; \
46312 uint8x16_t __s0_362 = __p0_362; \
46313 uint8x16_t __rev0_362; __rev0_362 = __builtin_shufflevector(__s0_362, __s0_362, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
46314 __ret_362 = __noswap_splatq_laneq_u8(__rev0_362, __p1_362); \
46315 __ret_362 = __builtin_shufflevector(__ret_362, __ret_362, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
46316 __ret_362; \
4582146317})
4582246318#endif
4582346319
4582446320#ifdef __LITTLE_ENDIAN__
45825#define vfma_laneq_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
45826 float16x4_t __ret; \
45827 float16x4_t __s0 = __p0; \
45828 float16x4_t __s1 = __p1; \
45829 float16x8_t __s2 = __p2; \
45830 __ret = (float16x4_t) __builtin_neon_vfma_laneq_v((int8x8_t)__s0, (int8x8_t)__s1, (int8x16_t)__s2, __p3, 8); \
45831 __ret; \
46321#define vdupq_laneq_u32(__p0_363, __p1_363) __extension__ ({ \
46322 uint32x4_t __ret_363; \
46323 uint32x4_t __s0_363 = __p0_363; \
46324 __ret_363 = splatq_laneq_u32(__s0_363, __p1_363); \
46325 __ret_363; \
4583246326})
4583346327#else
45834#define vfma_laneq_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
45835 float16x4_t __ret; \
45836 float16x4_t __s0 = __p0; \
45837 float16x4_t __s1 = __p1; \
45838 float16x8_t __s2 = __p2; \
45839 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
45840 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
45841 float16x8_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 7, 6, 5, 4, 3, 2, 1, 0); \
45842 __ret = (float16x4_t) __builtin_neon_vfma_laneq_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x16_t)__rev2, __p3, 8); \
45843 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
45844 __ret; \
46328#define vdupq_laneq_u32(__p0_364, __p1_364) __extension__ ({ \
46329 uint32x4_t __ret_364; \
46330 uint32x4_t __s0_364 = __p0_364; \
46331 uint32x4_t __rev0_364; __rev0_364 = __builtin_shufflevector(__s0_364, __s0_364, 3, 2, 1, 0); \
46332 __ret_364 = __noswap_splatq_laneq_u32(__rev0_364, __p1_364); \
46333 __ret_364 = __builtin_shufflevector(__ret_364, __ret_364, 3, 2, 1, 0); \
46334 __ret_364; \
4584546335})
45846#define __noswap_vfma_laneq_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
45847 float16x4_t __ret; \
45848 float16x4_t __s0 = __p0; \
45849 float16x4_t __s1 = __p1; \
45850 float16x8_t __s2 = __p2; \
45851 __ret = (float16x4_t) __builtin_neon_vfma_laneq_v((int8x8_t)__s0, (int8x8_t)__s1, (int8x16_t)__s2, __p3, 8); \
45852 __ret; \
46336#endif
46337
46338#ifdef __LITTLE_ENDIAN__
46339#define vdupq_laneq_u64(__p0_365, __p1_365) __extension__ ({ \
46340 uint64x2_t __ret_365; \
46341 uint64x2_t __s0_365 = __p0_365; \
46342 __ret_365 = splatq_laneq_u64(__s0_365, __p1_365); \
46343 __ret_365; \
46344})
46345#else
46346#define vdupq_laneq_u64(__p0_366, __p1_366) __extension__ ({ \
46347 uint64x2_t __ret_366; \
46348 uint64x2_t __s0_366 = __p0_366; \
46349 uint64x2_t __rev0_366; __rev0_366 = __builtin_shufflevector(__s0_366, __s0_366, 1, 0); \
46350 __ret_366 = __noswap_splatq_laneq_u64(__rev0_366, __p1_366); \
46351 __ret_366 = __builtin_shufflevector(__ret_366, __ret_366, 1, 0); \
46352 __ret_366; \
4585346353})
4585446354#endif
4585546355
4585646356#ifdef __LITTLE_ENDIAN__
45857#define vfmaq_n_f16(__p0, __p1, __p2) __extension__ ({ \
45858 float16x8_t __ret; \
45859 float16x8_t __s0 = __p0; \
45860 float16x8_t __s1 = __p1; \
45861 float16_t __s2 = __p2; \
45862 __ret = vfmaq_f16(__s0, __s1, (float16x8_t) {__s2, __s2, __s2, __s2, __s2, __s2, __s2, __s2}); \
45863 __ret; \
46357#define vdupq_laneq_u16(__p0_367, __p1_367) __extension__ ({ \
46358 uint16x8_t __ret_367; \
46359 uint16x8_t __s0_367 = __p0_367; \
46360 __ret_367 = splatq_laneq_u16(__s0_367, __p1_367); \
46361 __ret_367; \
4586446362})
4586546363#else
45866#define vfmaq_n_f16(__p0, __p1, __p2) __extension__ ({ \
45867 float16x8_t __ret; \
45868 float16x8_t __s0 = __p0; \
45869 float16x8_t __s1 = __p1; \
45870 float16_t __s2 = __p2; \
45871 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
45872 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
45873 __ret = __noswap_vfmaq_f16(__rev0, __rev1, (float16x8_t) {__s2, __s2, __s2, __s2, __s2, __s2, __s2, __s2}); \
45874 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
45875 __ret; \
46364#define vdupq_laneq_u16(__p0_368, __p1_368) __extension__ ({ \
46365 uint16x8_t __ret_368; \
46366 uint16x8_t __s0_368 = __p0_368; \
46367 uint16x8_t __rev0_368; __rev0_368 = __builtin_shufflevector(__s0_368, __s0_368, 7, 6, 5, 4, 3, 2, 1, 0); \
46368 __ret_368 = __noswap_splatq_laneq_u16(__rev0_368, __p1_368); \
46369 __ret_368 = __builtin_shufflevector(__ret_368, __ret_368, 7, 6, 5, 4, 3, 2, 1, 0); \
46370 __ret_368; \
4587646371})
4587746372#endif
4587846373
4587946374#ifdef __LITTLE_ENDIAN__
45880#define vfma_n_f16(__p0, __p1, __p2) __extension__ ({ \
45881 float16x4_t __ret; \
45882 float16x4_t __s0 = __p0; \
45883 float16x4_t __s1 = __p1; \
45884 float16_t __s2 = __p2; \
45885 __ret = vfma_f16(__s0, __s1, (float16x4_t) {__s2, __s2, __s2, __s2}); \
45886 __ret; \
46375#define vdupq_laneq_s8(__p0_369, __p1_369) __extension__ ({ \
46376 int8x16_t __ret_369; \
46377 int8x16_t __s0_369 = __p0_369; \
46378 __ret_369 = splatq_laneq_s8(__s0_369, __p1_369); \
46379 __ret_369; \
4588746380})
4588846381#else
45889#define vfma_n_f16(__p0, __p1, __p2) __extension__ ({ \
45890 float16x4_t __ret; \
45891 float16x4_t __s0 = __p0; \
45892 float16x4_t __s1 = __p1; \
45893 float16_t __s2 = __p2; \
45894 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
45895 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
45896 __ret = __noswap_vfma_f16(__rev0, __rev1, (float16x4_t) {__s2, __s2, __s2, __s2}); \
45897 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
45898 __ret; \
46382#define vdupq_laneq_s8(__p0_370, __p1_370) __extension__ ({ \
46383 int8x16_t __ret_370; \
46384 int8x16_t __s0_370 = __p0_370; \
46385 int8x16_t __rev0_370; __rev0_370 = __builtin_shufflevector(__s0_370, __s0_370, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
46386 __ret_370 = __noswap_splatq_laneq_s8(__rev0_370, __p1_370); \
46387 __ret_370 = __builtin_shufflevector(__ret_370, __ret_370, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
46388 __ret_370; \
4589946389})
4590046390#endif
4590146391
4590246392#ifdef __LITTLE_ENDIAN__
45903#define vfmsh_lane_f16(__p0_281, __p1_281, __p2_281, __p3_281) __extension__ ({ \
45904 float16_t __ret_281; \
45905 float16_t __s0_281 = __p0_281; \
45906 float16_t __s1_281 = __p1_281; \
45907 float16x4_t __s2_281 = __p2_281; \
45908 __ret_281 = vfmah_lane_f16(__s0_281, -__s1_281, __s2_281, __p3_281); \
45909 __ret_281; \
46393#define vdupq_laneq_f64(__p0_371, __p1_371) __extension__ ({ \
46394 float64x2_t __ret_371; \
46395 float64x2_t __s0_371 = __p0_371; \
46396 __ret_371 = splatq_laneq_f64(__s0_371, __p1_371); \
46397 __ret_371; \
4591046398})
4591146399#else
45912#define vfmsh_lane_f16(__p0_282, __p1_282, __p2_282, __p3_282) __extension__ ({ \
45913 float16_t __ret_282; \
45914 float16_t __s0_282 = __p0_282; \
45915 float16_t __s1_282 = __p1_282; \
45916 float16x4_t __s2_282 = __p2_282; \
45917 float16x4_t __rev2_282; __rev2_282 = __builtin_shufflevector(__s2_282, __s2_282, 3, 2, 1, 0); \
45918 __ret_282 = __noswap_vfmah_lane_f16(__s0_282, -__s1_282, __rev2_282, __p3_282); \
45919 __ret_282; \
46400#define vdupq_laneq_f64(__p0_372, __p1_372) __extension__ ({ \
46401 float64x2_t __ret_372; \
46402 float64x2_t __s0_372 = __p0_372; \
46403 float64x2_t __rev0_372; __rev0_372 = __builtin_shufflevector(__s0_372, __s0_372, 1, 0); \
46404 __ret_372 = __noswap_splatq_laneq_f64(__rev0_372, __p1_372); \
46405 __ret_372 = __builtin_shufflevector(__ret_372, __ret_372, 1, 0); \
46406 __ret_372; \
4592046407})
4592146408#endif
4592246409
4592346410#ifdef __LITTLE_ENDIAN__
45924#define vfmsq_lane_f16(__p0_283, __p1_283, __p2_283, __p3_283) __extension__ ({ \
45925 float16x8_t __ret_283; \
45926 float16x8_t __s0_283 = __p0_283; \
45927 float16x8_t __s1_283 = __p1_283; \
45928 float16x4_t __s2_283 = __p2_283; \
45929 __ret_283 = vfmaq_lane_f16(__s0_283, -__s1_283, __s2_283, __p3_283); \
45930 __ret_283; \
46411#define vdupq_laneq_f32(__p0_373, __p1_373) __extension__ ({ \
46412 float32x4_t __ret_373; \
46413 float32x4_t __s0_373 = __p0_373; \
46414 __ret_373 = splatq_laneq_f32(__s0_373, __p1_373); \
46415 __ret_373; \
4593146416})
4593246417#else
45933#define vfmsq_lane_f16(__p0_284, __p1_284, __p2_284, __p3_284) __extension__ ({ \
45934 float16x8_t __ret_284; \
45935 float16x8_t __s0_284 = __p0_284; \
45936 float16x8_t __s1_284 = __p1_284; \
45937 float16x4_t __s2_284 = __p2_284; \
45938 float16x8_t __rev0_284; __rev0_284 = __builtin_shufflevector(__s0_284, __s0_284, 7, 6, 5, 4, 3, 2, 1, 0); \
45939 float16x8_t __rev1_284; __rev1_284 = __builtin_shufflevector(__s1_284, __s1_284, 7, 6, 5, 4, 3, 2, 1, 0); \
45940 float16x4_t __rev2_284; __rev2_284 = __builtin_shufflevector(__s2_284, __s2_284, 3, 2, 1, 0); \
45941 __ret_284 = __noswap_vfmaq_lane_f16(__rev0_284, -__rev1_284, __rev2_284, __p3_284); \
45942 __ret_284 = __builtin_shufflevector(__ret_284, __ret_284, 7, 6, 5, 4, 3, 2, 1, 0); \
45943 __ret_284; \
46418#define vdupq_laneq_f32(__p0_374, __p1_374) __extension__ ({ \
46419 float32x4_t __ret_374; \
46420 float32x4_t __s0_374 = __p0_374; \
46421 float32x4_t __rev0_374; __rev0_374 = __builtin_shufflevector(__s0_374, __s0_374, 3, 2, 1, 0); \
46422 __ret_374 = __noswap_splatq_laneq_f32(__rev0_374, __p1_374); \
46423 __ret_374 = __builtin_shufflevector(__ret_374, __ret_374, 3, 2, 1, 0); \
46424 __ret_374; \
4594446425})
4594546426#endif
4594646427
4594746428#ifdef __LITTLE_ENDIAN__
45948#define vfms_lane_f16(__p0_285, __p1_285, __p2_285, __p3_285) __extension__ ({ \
45949 float16x4_t __ret_285; \
45950 float16x4_t __s0_285 = __p0_285; \
45951 float16x4_t __s1_285 = __p1_285; \
45952 float16x4_t __s2_285 = __p2_285; \
45953 __ret_285 = vfma_lane_f16(__s0_285, -__s1_285, __s2_285, __p3_285); \
45954 __ret_285; \
46429#define vdupq_laneq_f16(__p0_375, __p1_375) __extension__ ({ \
46430 float16x8_t __ret_375; \
46431 float16x8_t __s0_375 = __p0_375; \
46432 __ret_375 = splatq_laneq_f16(__s0_375, __p1_375); \
46433 __ret_375; \
4595546434})
4595646435#else
45957#define vfms_lane_f16(__p0_286, __p1_286, __p2_286, __p3_286) __extension__ ({ \
45958 float16x4_t __ret_286; \
45959 float16x4_t __s0_286 = __p0_286; \
45960 float16x4_t __s1_286 = __p1_286; \
45961 float16x4_t __s2_286 = __p2_286; \
45962 float16x4_t __rev0_286; __rev0_286 = __builtin_shufflevector(__s0_286, __s0_286, 3, 2, 1, 0); \
45963 float16x4_t __rev1_286; __rev1_286 = __builtin_shufflevector(__s1_286, __s1_286, 3, 2, 1, 0); \
45964 float16x4_t __rev2_286; __rev2_286 = __builtin_shufflevector(__s2_286, __s2_286, 3, 2, 1, 0); \
45965 __ret_286 = __noswap_vfma_lane_f16(__rev0_286, -__rev1_286, __rev2_286, __p3_286); \
45966 __ret_286 = __builtin_shufflevector(__ret_286, __ret_286, 3, 2, 1, 0); \
45967 __ret_286; \
46436#define vdupq_laneq_f16(__p0_376, __p1_376) __extension__ ({ \
46437 float16x8_t __ret_376; \
46438 float16x8_t __s0_376 = __p0_376; \
46439 float16x8_t __rev0_376; __rev0_376 = __builtin_shufflevector(__s0_376, __s0_376, 7, 6, 5, 4, 3, 2, 1, 0); \
46440 __ret_376 = __noswap_splatq_laneq_f16(__rev0_376, __p1_376); \
46441 __ret_376 = __builtin_shufflevector(__ret_376, __ret_376, 7, 6, 5, 4, 3, 2, 1, 0); \
46442 __ret_376; \
4596846443})
4596946444#endif
4597046445
4597146446#ifdef __LITTLE_ENDIAN__
45972#define vfmsh_laneq_f16(__p0_287, __p1_287, __p2_287, __p3_287) __extension__ ({ \
45973 float16_t __ret_287; \
45974 float16_t __s0_287 = __p0_287; \
45975 float16_t __s1_287 = __p1_287; \
45976 float16x8_t __s2_287 = __p2_287; \
45977 __ret_287 = vfmah_laneq_f16(__s0_287, -__s1_287, __s2_287, __p3_287); \
45978 __ret_287; \
46447#define vdupq_laneq_s32(__p0_377, __p1_377) __extension__ ({ \
46448 int32x4_t __ret_377; \
46449 int32x4_t __s0_377 = __p0_377; \
46450 __ret_377 = splatq_laneq_s32(__s0_377, __p1_377); \
46451 __ret_377; \
4597946452})
4598046453#else
45981#define vfmsh_laneq_f16(__p0_288, __p1_288, __p2_288, __p3_288) __extension__ ({ \
45982 float16_t __ret_288; \
45983 float16_t __s0_288 = __p0_288; \
45984 float16_t __s1_288 = __p1_288; \
45985 float16x8_t __s2_288 = __p2_288; \
45986 float16x8_t __rev2_288; __rev2_288 = __builtin_shufflevector(__s2_288, __s2_288, 7, 6, 5, 4, 3, 2, 1, 0); \
45987 __ret_288 = __noswap_vfmah_laneq_f16(__s0_288, -__s1_288, __rev2_288, __p3_288); \
45988 __ret_288; \
46454#define vdupq_laneq_s32(__p0_378, __p1_378) __extension__ ({ \
46455 int32x4_t __ret_378; \
46456 int32x4_t __s0_378 = __p0_378; \
46457 int32x4_t __rev0_378; __rev0_378 = __builtin_shufflevector(__s0_378, __s0_378, 3, 2, 1, 0); \
46458 __ret_378 = __noswap_splatq_laneq_s32(__rev0_378, __p1_378); \
46459 __ret_378 = __builtin_shufflevector(__ret_378, __ret_378, 3, 2, 1, 0); \
46460 __ret_378; \
4598946461})
4599046462#endif
4599146463
4599246464#ifdef __LITTLE_ENDIAN__
45993#define vfmsq_laneq_f16(__p0_289, __p1_289, __p2_289, __p3_289) __extension__ ({ \
45994 float16x8_t __ret_289; \
45995 float16x8_t __s0_289 = __p0_289; \
45996 float16x8_t __s1_289 = __p1_289; \
45997 float16x8_t __s2_289 = __p2_289; \
45998 __ret_289 = vfmaq_laneq_f16(__s0_289, -__s1_289, __s2_289, __p3_289); \
45999 __ret_289; \
46465#define vdupq_laneq_s64(__p0_379, __p1_379) __extension__ ({ \
46466 int64x2_t __ret_379; \
46467 int64x2_t __s0_379 = __p0_379; \
46468 __ret_379 = splatq_laneq_s64(__s0_379, __p1_379); \
46469 __ret_379; \
4600046470})
4600146471#else
46002#define vfmsq_laneq_f16(__p0_290, __p1_290, __p2_290, __p3_290) __extension__ ({ \
46003 float16x8_t __ret_290; \
46004 float16x8_t __s0_290 = __p0_290; \
46005 float16x8_t __s1_290 = __p1_290; \
46006 float16x8_t __s2_290 = __p2_290; \
46007 float16x8_t __rev0_290; __rev0_290 = __builtin_shufflevector(__s0_290, __s0_290, 7, 6, 5, 4, 3, 2, 1, 0); \
46008 float16x8_t __rev1_290; __rev1_290 = __builtin_shufflevector(__s1_290, __s1_290, 7, 6, 5, 4, 3, 2, 1, 0); \
46009 float16x8_t __rev2_290; __rev2_290 = __builtin_shufflevector(__s2_290, __s2_290, 7, 6, 5, 4, 3, 2, 1, 0); \
46010 __ret_290 = __noswap_vfmaq_laneq_f16(__rev0_290, -__rev1_290, __rev2_290, __p3_290); \
46011 __ret_290 = __builtin_shufflevector(__ret_290, __ret_290, 7, 6, 5, 4, 3, 2, 1, 0); \
46012 __ret_290; \
46472#define vdupq_laneq_s64(__p0_380, __p1_380) __extension__ ({ \
46473 int64x2_t __ret_380; \
46474 int64x2_t __s0_380 = __p0_380; \
46475 int64x2_t __rev0_380; __rev0_380 = __builtin_shufflevector(__s0_380, __s0_380, 1, 0); \
46476 __ret_380 = __noswap_splatq_laneq_s64(__rev0_380, __p1_380); \
46477 __ret_380 = __builtin_shufflevector(__ret_380, __ret_380, 1, 0); \
46478 __ret_380; \
4601346479})
4601446480#endif
4601546481
4601646482#ifdef __LITTLE_ENDIAN__
46017#define vfms_laneq_f16(__p0_291, __p1_291, __p2_291, __p3_291) __extension__ ({ \
46018 float16x4_t __ret_291; \
46019 float16x4_t __s0_291 = __p0_291; \
46020 float16x4_t __s1_291 = __p1_291; \
46021 float16x8_t __s2_291 = __p2_291; \
46022 __ret_291 = vfma_laneq_f16(__s0_291, -__s1_291, __s2_291, __p3_291); \
46023 __ret_291; \
46483#define vdupq_laneq_s16(__p0_381, __p1_381) __extension__ ({ \
46484 int16x8_t __ret_381; \
46485 int16x8_t __s0_381 = __p0_381; \
46486 __ret_381 = splatq_laneq_s16(__s0_381, __p1_381); \
46487 __ret_381; \
4602446488})
4602546489#else
46026#define vfms_laneq_f16(__p0_292, __p1_292, __p2_292, __p3_292) __extension__ ({ \
46027 float16x4_t __ret_292; \
46028 float16x4_t __s0_292 = __p0_292; \
46029 float16x4_t __s1_292 = __p1_292; \
46030 float16x8_t __s2_292 = __p2_292; \
46031 float16x4_t __rev0_292; __rev0_292 = __builtin_shufflevector(__s0_292, __s0_292, 3, 2, 1, 0); \
46032 float16x4_t __rev1_292; __rev1_292 = __builtin_shufflevector(__s1_292, __s1_292, 3, 2, 1, 0); \
46033 float16x8_t __rev2_292; __rev2_292 = __builtin_shufflevector(__s2_292, __s2_292, 7, 6, 5, 4, 3, 2, 1, 0); \
46034 __ret_292 = __noswap_vfma_laneq_f16(__rev0_292, -__rev1_292, __rev2_292, __p3_292); \
46035 __ret_292 = __builtin_shufflevector(__ret_292, __ret_292, 3, 2, 1, 0); \
46036 __ret_292; \
46490#define vdupq_laneq_s16(__p0_382, __p1_382) __extension__ ({ \
46491 int16x8_t __ret_382; \
46492 int16x8_t __s0_382 = __p0_382; \
46493 int16x8_t __rev0_382; __rev0_382 = __builtin_shufflevector(__s0_382, __s0_382, 7, 6, 5, 4, 3, 2, 1, 0); \
46494 __ret_382 = __noswap_splatq_laneq_s16(__rev0_382, __p1_382); \
46495 __ret_382 = __builtin_shufflevector(__ret_382, __ret_382, 7, 6, 5, 4, 3, 2, 1, 0); \
46496 __ret_382; \
4603746497})
4603846498#endif
4603946499
4604046500#ifdef __LITTLE_ENDIAN__
46041#define vfmsq_n_f16(__p0, __p1, __p2) __extension__ ({ \
46042 float16x8_t __ret; \
46043 float16x8_t __s0 = __p0; \
46044 float16x8_t __s1 = __p1; \
46045 float16_t __s2 = __p2; \
46046 __ret = vfmaq_f16(__s0, -__s1, (float16x8_t) {__s2, __s2, __s2, __s2, __s2, __s2, __s2, __s2}); \
46047 __ret; \
46501#define vdup_laneq_u8(__p0_383, __p1_383) __extension__ ({ \
46502 uint8x8_t __ret_383; \
46503 uint8x16_t __s0_383 = __p0_383; \
46504 __ret_383 = splat_laneq_u8(__s0_383, __p1_383); \
46505 __ret_383; \
4604846506})
4604946507#else
46050#define vfmsq_n_f16(__p0, __p1, __p2) __extension__ ({ \
46051 float16x8_t __ret; \
46052 float16x8_t __s0 = __p0; \
46053 float16x8_t __s1 = __p1; \
46054 float16_t __s2 = __p2; \
46055 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
46056 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
46057 __ret = __noswap_vfmaq_f16(__rev0, -__rev1, (float16x8_t) {__s2, __s2, __s2, __s2, __s2, __s2, __s2, __s2}); \
46058 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
46059 __ret; \
46508#define vdup_laneq_u8(__p0_384, __p1_384) __extension__ ({ \
46509 uint8x8_t __ret_384; \
46510 uint8x16_t __s0_384 = __p0_384; \
46511 uint8x16_t __rev0_384; __rev0_384 = __builtin_shufflevector(__s0_384, __s0_384, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
46512 __ret_384 = __noswap_splat_laneq_u8(__rev0_384, __p1_384); \
46513 __ret_384 = __builtin_shufflevector(__ret_384, __ret_384, 7, 6, 5, 4, 3, 2, 1, 0); \
46514 __ret_384; \
4606046515})
4606146516#endif
4606246517
4606346518#ifdef __LITTLE_ENDIAN__
46064#define vfms_n_f16(__p0, __p1, __p2) __extension__ ({ \
46065 float16x4_t __ret; \
46066 float16x4_t __s0 = __p0; \
46067 float16x4_t __s1 = __p1; \
46068 float16_t __s2 = __p2; \
46069 __ret = vfma_f16(__s0, -__s1, (float16x4_t) {__s2, __s2, __s2, __s2}); \
46070 __ret; \
46519#define vdup_laneq_u32(__p0_385, __p1_385) __extension__ ({ \
46520 uint32x2_t __ret_385; \
46521 uint32x4_t __s0_385 = __p0_385; \
46522 __ret_385 = splat_laneq_u32(__s0_385, __p1_385); \
46523 __ret_385; \
4607146524})
4607246525#else
46073#define vfms_n_f16(__p0, __p1, __p2) __extension__ ({ \
46074 float16x4_t __ret; \
46075 float16x4_t __s0 = __p0; \
46076 float16x4_t __s1 = __p1; \
46077 float16_t __s2 = __p2; \
46078 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
46079 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
46080 __ret = __noswap_vfma_f16(__rev0, -__rev1, (float16x4_t) {__s2, __s2, __s2, __s2}); \
46081 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
46082 __ret; \
46526#define vdup_laneq_u32(__p0_386, __p1_386) __extension__ ({ \
46527 uint32x2_t __ret_386; \
46528 uint32x4_t __s0_386 = __p0_386; \
46529 uint32x4_t __rev0_386; __rev0_386 = __builtin_shufflevector(__s0_386, __s0_386, 3, 2, 1, 0); \
46530 __ret_386 = __noswap_splat_laneq_u32(__rev0_386, __p1_386); \
46531 __ret_386 = __builtin_shufflevector(__ret_386, __ret_386, 1, 0); \
46532 __ret_386; \
4608346533})
4608446534#endif
4608546535
4608646536#ifdef __LITTLE_ENDIAN__
46087#define vmaxnmvq_f16(__p0) __extension__ ({ \
46088 float16_t __ret; \
46089 float16x8_t __s0 = __p0; \
46090 __ret = (float16_t) __builtin_neon_vmaxnmvq_f16((int8x16_t)__s0); \
46091 __ret; \
46537#define vdup_laneq_u64(__p0_387, __p1_387) __extension__ ({ \
46538 uint64x1_t __ret_387; \
46539 uint64x2_t __s0_387 = __p0_387; \
46540 __ret_387 = splat_laneq_u64(__s0_387, __p1_387); \
46541 __ret_387; \
4609246542})
4609346543#else
46094#define vmaxnmvq_f16(__p0) __extension__ ({ \
46095 float16_t __ret; \
46096 float16x8_t __s0 = __p0; \
46097 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
46098 __ret = (float16_t) __builtin_neon_vmaxnmvq_f16((int8x16_t)__rev0); \
46099 __ret; \
46544#define vdup_laneq_u64(__p0_388, __p1_388) __extension__ ({ \
46545 uint64x1_t __ret_388; \
46546 uint64x2_t __s0_388 = __p0_388; \
46547 uint64x2_t __rev0_388; __rev0_388 = __builtin_shufflevector(__s0_388, __s0_388, 1, 0); \
46548 __ret_388 = __noswap_splat_laneq_u64(__rev0_388, __p1_388); \
46549 __ret_388; \
4610046550})
4610146551#endif
4610246552
4610346553#ifdef __LITTLE_ENDIAN__
46104#define vmaxnmv_f16(__p0) __extension__ ({ \
46105 float16_t __ret; \
46106 float16x4_t __s0 = __p0; \
46107 __ret = (float16_t) __builtin_neon_vmaxnmv_f16((int8x8_t)__s0); \
46108 __ret; \
46554#define vdup_laneq_u16(__p0_389, __p1_389) __extension__ ({ \
46555 uint16x4_t __ret_389; \
46556 uint16x8_t __s0_389 = __p0_389; \
46557 __ret_389 = splat_laneq_u16(__s0_389, __p1_389); \
46558 __ret_389; \
4610946559})
4611046560#else
46111#define vmaxnmv_f16(__p0) __extension__ ({ \
46112 float16_t __ret; \
46113 float16x4_t __s0 = __p0; \
46114 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
46115 __ret = (float16_t) __builtin_neon_vmaxnmv_f16((int8x8_t)__rev0); \
46116 __ret; \
46561#define vdup_laneq_u16(__p0_390, __p1_390) __extension__ ({ \
46562 uint16x4_t __ret_390; \
46563 uint16x8_t __s0_390 = __p0_390; \
46564 uint16x8_t __rev0_390; __rev0_390 = __builtin_shufflevector(__s0_390, __s0_390, 7, 6, 5, 4, 3, 2, 1, 0); \
46565 __ret_390 = __noswap_splat_laneq_u16(__rev0_390, __p1_390); \
46566 __ret_390 = __builtin_shufflevector(__ret_390, __ret_390, 3, 2, 1, 0); \
46567 __ret_390; \
4611746568})
4611846569#endif
4611946570
4612046571#ifdef __LITTLE_ENDIAN__
46121#define vmaxvq_f16(__p0) __extension__ ({ \
46122 float16_t __ret; \
46123 float16x8_t __s0 = __p0; \
46124 __ret = (float16_t) __builtin_neon_vmaxvq_f16((int8x16_t)__s0); \
46125 __ret; \
46572#define vdup_laneq_s8(__p0_391, __p1_391) __extension__ ({ \
46573 int8x8_t __ret_391; \
46574 int8x16_t __s0_391 = __p0_391; \
46575 __ret_391 = splat_laneq_s8(__s0_391, __p1_391); \
46576 __ret_391; \
4612646577})
4612746578#else
46128#define vmaxvq_f16(__p0) __extension__ ({ \
46129 float16_t __ret; \
46130 float16x8_t __s0 = __p0; \
46131 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
46132 __ret = (float16_t) __builtin_neon_vmaxvq_f16((int8x16_t)__rev0); \
46133 __ret; \
46579#define vdup_laneq_s8(__p0_392, __p1_392) __extension__ ({ \
46580 int8x8_t __ret_392; \
46581 int8x16_t __s0_392 = __p0_392; \
46582 int8x16_t __rev0_392; __rev0_392 = __builtin_shufflevector(__s0_392, __s0_392, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
46583 __ret_392 = __noswap_splat_laneq_s8(__rev0_392, __p1_392); \
46584 __ret_392 = __builtin_shufflevector(__ret_392, __ret_392, 7, 6, 5, 4, 3, 2, 1, 0); \
46585 __ret_392; \
4613446586})
4613546587#endif
4613646588
4613746589#ifdef __LITTLE_ENDIAN__
46138#define vmaxv_f16(__p0) __extension__ ({ \
46139 float16_t __ret; \
46140 float16x4_t __s0 = __p0; \
46141 __ret = (float16_t) __builtin_neon_vmaxv_f16((int8x8_t)__s0); \
46142 __ret; \
46590#define vdup_laneq_f64(__p0_393, __p1_393) __extension__ ({ \
46591 float64x1_t __ret_393; \
46592 float64x2_t __s0_393 = __p0_393; \
46593 __ret_393 = splat_laneq_f64(__s0_393, __p1_393); \
46594 __ret_393; \
4614346595})
4614446596#else
46145#define vmaxv_f16(__p0) __extension__ ({ \
46146 float16_t __ret; \
46147 float16x4_t __s0 = __p0; \
46148 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
46149 __ret = (float16_t) __builtin_neon_vmaxv_f16((int8x8_t)__rev0); \
46150 __ret; \
46597#define vdup_laneq_f64(__p0_394, __p1_394) __extension__ ({ \
46598 float64x1_t __ret_394; \
46599 float64x2_t __s0_394 = __p0_394; \
46600 float64x2_t __rev0_394; __rev0_394 = __builtin_shufflevector(__s0_394, __s0_394, 1, 0); \
46601 __ret_394 = __noswap_splat_laneq_f64(__rev0_394, __p1_394); \
46602 __ret_394; \
4615146603})
4615246604#endif
4615346605
4615446606#ifdef __LITTLE_ENDIAN__
46155#define vminnmvq_f16(__p0) __extension__ ({ \
46156 float16_t __ret; \
46157 float16x8_t __s0 = __p0; \
46158 __ret = (float16_t) __builtin_neon_vminnmvq_f16((int8x16_t)__s0); \
46159 __ret; \
46607#define vdup_laneq_f32(__p0_395, __p1_395) __extension__ ({ \
46608 float32x2_t __ret_395; \
46609 float32x4_t __s0_395 = __p0_395; \
46610 __ret_395 = splat_laneq_f32(__s0_395, __p1_395); \
46611 __ret_395; \
4616046612})
4616146613#else
46162#define vminnmvq_f16(__p0) __extension__ ({ \
46163 float16_t __ret; \
46164 float16x8_t __s0 = __p0; \
46165 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
46166 __ret = (float16_t) __builtin_neon_vminnmvq_f16((int8x16_t)__rev0); \
46167 __ret; \
46614#define vdup_laneq_f32(__p0_396, __p1_396) __extension__ ({ \
46615 float32x2_t __ret_396; \
46616 float32x4_t __s0_396 = __p0_396; \
46617 float32x4_t __rev0_396; __rev0_396 = __builtin_shufflevector(__s0_396, __s0_396, 3, 2, 1, 0); \
46618 __ret_396 = __noswap_splat_laneq_f32(__rev0_396, __p1_396); \
46619 __ret_396 = __builtin_shufflevector(__ret_396, __ret_396, 1, 0); \
46620 __ret_396; \
4616846621})
4616946622#endif
4617046623
4617146624#ifdef __LITTLE_ENDIAN__
46172#define vminnmv_f16(__p0) __extension__ ({ \
46173 float16_t __ret; \
46174 float16x4_t __s0 = __p0; \
46175 __ret = (float16_t) __builtin_neon_vminnmv_f16((int8x8_t)__s0); \
46176 __ret; \
46625#define vdup_laneq_f16(__p0_397, __p1_397) __extension__ ({ \
46626 float16x4_t __ret_397; \
46627 float16x8_t __s0_397 = __p0_397; \
46628 __ret_397 = splat_laneq_f16(__s0_397, __p1_397); \
46629 __ret_397; \
4617746630})
4617846631#else
46179#define vminnmv_f16(__p0) __extension__ ({ \
46180 float16_t __ret; \
46181 float16x4_t __s0 = __p0; \
46182 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
46183 __ret = (float16_t) __builtin_neon_vminnmv_f16((int8x8_t)__rev0); \
46184 __ret; \
46632#define vdup_laneq_f16(__p0_398, __p1_398) __extension__ ({ \
46633 float16x4_t __ret_398; \
46634 float16x8_t __s0_398 = __p0_398; \
46635 float16x8_t __rev0_398; __rev0_398 = __builtin_shufflevector(__s0_398, __s0_398, 7, 6, 5, 4, 3, 2, 1, 0); \
46636 __ret_398 = __noswap_splat_laneq_f16(__rev0_398, __p1_398); \
46637 __ret_398 = __builtin_shufflevector(__ret_398, __ret_398, 3, 2, 1, 0); \
46638 __ret_398; \
4618546639})
4618646640#endif
4618746641
4618846642#ifdef __LITTLE_ENDIAN__
46189#define vminvq_f16(__p0) __extension__ ({ \
46190 float16_t __ret; \
46191 float16x8_t __s0 = __p0; \
46192 __ret = (float16_t) __builtin_neon_vminvq_f16((int8x16_t)__s0); \
46193 __ret; \
46643#define vdup_laneq_s32(__p0_399, __p1_399) __extension__ ({ \
46644 int32x2_t __ret_399; \
46645 int32x4_t __s0_399 = __p0_399; \
46646 __ret_399 = splat_laneq_s32(__s0_399, __p1_399); \
46647 __ret_399; \
4619446648})
4619546649#else
46196#define vminvq_f16(__p0) __extension__ ({ \
46197 float16_t __ret; \
46198 float16x8_t __s0 = __p0; \
46199 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
46200 __ret = (float16_t) __builtin_neon_vminvq_f16((int8x16_t)__rev0); \
46201 __ret; \
46650#define vdup_laneq_s32(__p0_400, __p1_400) __extension__ ({ \
46651 int32x2_t __ret_400; \
46652 int32x4_t __s0_400 = __p0_400; \
46653 int32x4_t __rev0_400; __rev0_400 = __builtin_shufflevector(__s0_400, __s0_400, 3, 2, 1, 0); \
46654 __ret_400 = __noswap_splat_laneq_s32(__rev0_400, __p1_400); \
46655 __ret_400 = __builtin_shufflevector(__ret_400, __ret_400, 1, 0); \
46656 __ret_400; \
4620246657})
4620346658#endif
4620446659
4620546660#ifdef __LITTLE_ENDIAN__
46206#define vminv_f16(__p0) __extension__ ({ \
46207 float16_t __ret; \
46208 float16x4_t __s0 = __p0; \
46209 __ret = (float16_t) __builtin_neon_vminv_f16((int8x8_t)__s0); \
46210 __ret; \
46661#define vdup_laneq_s64(__p0_401, __p1_401) __extension__ ({ \
46662 int64x1_t __ret_401; \
46663 int64x2_t __s0_401 = __p0_401; \
46664 __ret_401 = splat_laneq_s64(__s0_401, __p1_401); \
46665 __ret_401; \
4621146666})
4621246667#else
46213#define vminv_f16(__p0) __extension__ ({ \
46214 float16_t __ret; \
46215 float16x4_t __s0 = __p0; \
46216 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
46217 __ret = (float16_t) __builtin_neon_vminv_f16((int8x8_t)__rev0); \
46218 __ret; \
46668#define vdup_laneq_s64(__p0_402, __p1_402) __extension__ ({ \
46669 int64x1_t __ret_402; \
46670 int64x2_t __s0_402 = __p0_402; \
46671 int64x2_t __rev0_402; __rev0_402 = __builtin_shufflevector(__s0_402, __s0_402, 1, 0); \
46672 __ret_402 = __noswap_splat_laneq_s64(__rev0_402, __p1_402); \
46673 __ret_402; \
4621946674})
4622046675#endif
4622146676
4622246677#ifdef __LITTLE_ENDIAN__
46223#define vmulq_laneq_f16(__p0_293, __p1_293, __p2_293) __extension__ ({ \
46224 float16x8_t __ret_293; \
46225 float16x8_t __s0_293 = __p0_293; \
46226 float16x8_t __s1_293 = __p1_293; \
46227 __ret_293 = __s0_293 * splatq_laneq_f16(__s1_293, __p2_293); \
46228 __ret_293; \
46678#define vdup_laneq_s16(__p0_403, __p1_403) __extension__ ({ \
46679 int16x4_t __ret_403; \
46680 int16x8_t __s0_403 = __p0_403; \
46681 __ret_403 = splat_laneq_s16(__s0_403, __p1_403); \
46682 __ret_403; \
4622946683})
4623046684#else
46231#define vmulq_laneq_f16(__p0_294, __p1_294, __p2_294) __extension__ ({ \
46232 float16x8_t __ret_294; \
46233 float16x8_t __s0_294 = __p0_294; \
46234 float16x8_t __s1_294 = __p1_294; \
46235 float16x8_t __rev0_294; __rev0_294 = __builtin_shufflevector(__s0_294, __s0_294, 7, 6, 5, 4, 3, 2, 1, 0); \
46236 float16x8_t __rev1_294; __rev1_294 = __builtin_shufflevector(__s1_294, __s1_294, 7, 6, 5, 4, 3, 2, 1, 0); \
46237 __ret_294 = __rev0_294 * __noswap_splatq_laneq_f16(__rev1_294, __p2_294); \
46238 __ret_294 = __builtin_shufflevector(__ret_294, __ret_294, 7, 6, 5, 4, 3, 2, 1, 0); \
46239 __ret_294; \
46685#define vdup_laneq_s16(__p0_404, __p1_404) __extension__ ({ \
46686 int16x4_t __ret_404; \
46687 int16x8_t __s0_404 = __p0_404; \
46688 int16x8_t __rev0_404; __rev0_404 = __builtin_shufflevector(__s0_404, __s0_404, 7, 6, 5, 4, 3, 2, 1, 0); \
46689 __ret_404 = __noswap_splat_laneq_s16(__rev0_404, __p1_404); \
46690 __ret_404 = __builtin_shufflevector(__ret_404, __ret_404, 3, 2, 1, 0); \
46691 __ret_404; \
4624046692})
4624146693#endif
4624246694
46695__ai poly64x1_t vdup_n_p64(poly64_t __p0) {
46696 poly64x1_t __ret;
46697 __ret = (poly64x1_t) {__p0};
46698 return __ret;
46699}
4624346700#ifdef __LITTLE_ENDIAN__
46244#define vmul_laneq_f16(__p0_295, __p1_295, __p2_295) __extension__ ({ \
46245 float16x4_t __ret_295; \
46246 float16x4_t __s0_295 = __p0_295; \
46247 float16x8_t __s1_295 = __p1_295; \
46248 __ret_295 = __s0_295 * splat_laneq_f16(__s1_295, __p2_295); \
46249 __ret_295; \
46250})
46701__ai poly64x2_t vdupq_n_p64(poly64_t __p0) {
46702 poly64x2_t __ret;
46703 __ret = (poly64x2_t) {__p0, __p0};
46704 return __ret;
46705}
4625146706#else
46252#define vmul_laneq_f16(__p0_296, __p1_296, __p2_296) __extension__ ({ \
46253 float16x4_t __ret_296; \
46254 float16x4_t __s0_296 = __p0_296; \
46255 float16x8_t __s1_296 = __p1_296; \
46256 float16x4_t __rev0_296; __rev0_296 = __builtin_shufflevector(__s0_296, __s0_296, 3, 2, 1, 0); \
46257 float16x8_t __rev1_296; __rev1_296 = __builtin_shufflevector(__s1_296, __s1_296, 7, 6, 5, 4, 3, 2, 1, 0); \
46258 __ret_296 = __rev0_296 * __noswap_splat_laneq_f16(__rev1_296, __p2_296); \
46259 __ret_296 = __builtin_shufflevector(__ret_296, __ret_296, 3, 2, 1, 0); \
46260 __ret_296; \
46261})
46707__ai poly64x2_t vdupq_n_p64(poly64_t __p0) {
46708 poly64x2_t __ret;
46709 __ret = (poly64x2_t) {__p0, __p0};
46710 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
46711 return __ret;
46712}
4626246713#endif
4626346714
4626446715#ifdef __LITTLE_ENDIAN__
46265__ai float16x8_t vmulxq_f16(float16x8_t __p0, float16x8_t __p1) {
46266 float16x8_t __ret;
46267 __ret = (float16x8_t) __builtin_neon_vmulxq_v((int8x16_t)__p0, (int8x16_t)__p1, 40);
46716__ai float64x2_t vdupq_n_f64(float64_t __p0) {
46717 float64x2_t __ret;
46718 __ret = (float64x2_t) {__p0, __p0};
4626846719 return __ret;
4626946720}
4627046721#else
46271__ai float16x8_t vmulxq_f16(float16x8_t __p0, float16x8_t __p1) {
46272 float16x8_t __ret;
46273 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
46274 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
46275 __ret = (float16x8_t) __builtin_neon_vmulxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
46276 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
46722__ai float64x2_t vdupq_n_f64(float64_t __p0) {
46723 float64x2_t __ret;
46724 __ret = (float64x2_t) {__p0, __p0};
46725 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4627746726 return __ret;
4627846727}
46279__ai float16x8_t __noswap_vmulxq_f16(float16x8_t __p0, float16x8_t __p1) {
46280 float16x8_t __ret;
46281 __ret = (float16x8_t) __builtin_neon_vmulxq_v((int8x16_t)__p0, (int8x16_t)__p1, 40);
46728#endif
46729
46730__ai float64x1_t vdup_n_f64(float64_t __p0) {
46731 float64x1_t __ret;
46732 __ret = (float64x1_t) {__p0};
4628246733 return __ret;
4628346734}
46735#define vext_p64(__p0, __p1, __p2) __extension__ ({ \
46736 poly64x1_t __ret; \
46737 poly64x1_t __s0 = __p0; \
46738 poly64x1_t __s1 = __p1; \
46739 __ret = (poly64x1_t) __builtin_neon_vext_v((int8x8_t)__s0, (int8x8_t)__s1, __p2, 6); \
46740 __ret; \
46741})
46742#ifdef __LITTLE_ENDIAN__
46743#define vextq_p64(__p0, __p1, __p2) __extension__ ({ \
46744 poly64x2_t __ret; \
46745 poly64x2_t __s0 = __p0; \
46746 poly64x2_t __s1 = __p1; \
46747 __ret = (poly64x2_t) __builtin_neon_vextq_v((int8x16_t)__s0, (int8x16_t)__s1, __p2, 38); \
46748 __ret; \
46749})
46750#else
46751#define vextq_p64(__p0, __p1, __p2) __extension__ ({ \
46752 poly64x2_t __ret; \
46753 poly64x2_t __s0 = __p0; \
46754 poly64x2_t __s1 = __p1; \
46755 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
46756 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
46757 __ret = (poly64x2_t) __builtin_neon_vextq_v((int8x16_t)__rev0, (int8x16_t)__rev1, __p2, 38); \
46758 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
46759 __ret; \
46760})
4628446761#endif
4628546762
4628646763#ifdef __LITTLE_ENDIAN__
46287__ai float16x4_t vmulx_f16(float16x4_t __p0, float16x4_t __p1) {
46288 float16x4_t __ret;
46289 __ret = (float16x4_t) __builtin_neon_vmulx_v((int8x8_t)__p0, (int8x8_t)__p1, 8);
46764#define vextq_f64(__p0, __p1, __p2) __extension__ ({ \
46765 float64x2_t __ret; \
46766 float64x2_t __s0 = __p0; \
46767 float64x2_t __s1 = __p1; \
46768 __ret = (float64x2_t) __builtin_neon_vextq_v((int8x16_t)__s0, (int8x16_t)__s1, __p2, 42); \
46769 __ret; \
46770})
46771#else
46772#define vextq_f64(__p0, __p1, __p2) __extension__ ({ \
46773 float64x2_t __ret; \
46774 float64x2_t __s0 = __p0; \
46775 float64x2_t __s1 = __p1; \
46776 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
46777 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
46778 __ret = (float64x2_t) __builtin_neon_vextq_v((int8x16_t)__rev0, (int8x16_t)__rev1, __p2, 42); \
46779 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
46780 __ret; \
46781})
46782#endif
46783
46784#define vext_f64(__p0, __p1, __p2) __extension__ ({ \
46785 float64x1_t __ret; \
46786 float64x1_t __s0 = __p0; \
46787 float64x1_t __s1 = __p1; \
46788 __ret = (float64x1_t) __builtin_neon_vext_v((int8x8_t)__s0, (int8x8_t)__s1, __p2, 10); \
46789 __ret; \
46790})
46791#ifdef __LITTLE_ENDIAN__
46792__ai float64x2_t vfmaq_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
46793 float64x2_t __ret;
46794 __ret = (float64x2_t) __builtin_neon_vfmaq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 42);
4629046795 return __ret;
4629146796}
4629246797#else
46293__ai float16x4_t vmulx_f16(float16x4_t __p0, float16x4_t __p1) {
46294 float16x4_t __ret;
46295 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
46296 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
46297 __ret = (float16x4_t) __builtin_neon_vmulx_v((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
46298 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
46798__ai float64x2_t vfmaq_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
46799 float64x2_t __ret;
46800 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
46801 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
46802 float64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
46803 __ret = (float64x2_t) __builtin_neon_vfmaq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 42);
46804 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4629946805 return __ret;
4630046806}
46301__ai float16x4_t __noswap_vmulx_f16(float16x4_t __p0, float16x4_t __p1) {
46302 float16x4_t __ret;
46303 __ret = (float16x4_t) __builtin_neon_vmulx_v((int8x8_t)__p0, (int8x8_t)__p1, 8);
46807__ai float64x2_t __noswap_vfmaq_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
46808 float64x2_t __ret;
46809 __ret = (float64x2_t) __builtin_neon_vfmaq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 42);
4630446810 return __ret;
4630546811}
4630646812#endif
4630746813
46814__ai float64x1_t vfma_f64(float64x1_t __p0, float64x1_t __p1, float64x1_t __p2) {
46815 float64x1_t __ret;
46816 __ret = (float64x1_t) __builtin_neon_vfma_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 10);
46817 return __ret;
46818}
46819#define vfmad_lane_f64(__p0, __p1, __p2, __p3) __extension__ ({ \
46820 float64_t __ret; \
46821 float64_t __s0 = __p0; \
46822 float64_t __s1 = __p1; \
46823 float64x1_t __s2 = __p2; \
46824 __ret = (float64_t) __builtin_neon_vfmad_lane_f64(__s0, __s1, (float64x1_t)__s2, __p3); \
46825 __ret; \
46826})
4630846827#ifdef __LITTLE_ENDIAN__
46309#define vmulxh_lane_f16(__p0, __p1, __p2) __extension__ ({ \
46310 float16_t __ret; \
46311 float16_t __s0 = __p0; \
46312 float16x4_t __s1 = __p1; \
46313 __ret = (float16_t) __builtin_neon_vmulxh_lane_f16(__s0, (float16x4_t)__s1, __p2); \
46828#define vfmas_lane_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
46829 float32_t __ret; \
46830 float32_t __s0 = __p0; \
46831 float32_t __s1 = __p1; \
46832 float32x2_t __s2 = __p2; \
46833 __ret = (float32_t) __builtin_neon_vfmas_lane_f32(__s0, __s1, (float32x2_t)__s2, __p3); \
4631446834 __ret; \
4631546835})
4631646836#else
46317#define vmulxh_lane_f16(__p0, __p1, __p2) __extension__ ({ \
46318 float16_t __ret; \
46319 float16_t __s0 = __p0; \
46320 float16x4_t __s1 = __p1; \
46321 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
46322 __ret = (float16_t) __builtin_neon_vmulxh_lane_f16(__s0, (float16x4_t)__rev1, __p2); \
46837#define vfmas_lane_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
46838 float32_t __ret; \
46839 float32_t __s0 = __p0; \
46840 float32_t __s1 = __p1; \
46841 float32x2_t __s2 = __p2; \
46842 float32x2_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 1, 0); \
46843 __ret = (float32_t) __builtin_neon_vfmas_lane_f32(__s0, __s1, (float32x2_t)__rev2, __p3); \
46844 __ret; \
46845})
46846#define __noswap_vfmas_lane_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
46847 float32_t __ret; \
46848 float32_t __s0 = __p0; \
46849 float32_t __s1 = __p1; \
46850 float32x2_t __s2 = __p2; \
46851 __ret = (float32_t) __builtin_neon_vfmas_lane_f32(__s0, __s1, (float32x2_t)__s2, __p3); \
4632346852 __ret; \
4632446853})
4632546854#endif
4632646855
4632746856#ifdef __LITTLE_ENDIAN__
46328#define vmulxq_lane_f16(__p0_297, __p1_297, __p2_297) __extension__ ({ \
46329 float16x8_t __ret_297; \
46330 float16x8_t __s0_297 = __p0_297; \
46331 float16x4_t __s1_297 = __p1_297; \
46332 __ret_297 = vmulxq_f16(__s0_297, splatq_lane_f16(__s1_297, __p2_297)); \
46333 __ret_297; \
46857#define vfmaq_lane_f64(__p0, __p1, __p2, __p3) __extension__ ({ \
46858 float64x2_t __ret; \
46859 float64x2_t __s0 = __p0; \
46860 float64x2_t __s1 = __p1; \
46861 float64x1_t __s2 = __p2; \
46862 __ret = (float64x2_t) __builtin_neon_vfmaq_lane_v((int8x16_t)__s0, (int8x16_t)__s1, (int8x8_t)__s2, __p3, 42); \
46863 __ret; \
4633446864})
4633546865#else
46336#define vmulxq_lane_f16(__p0_298, __p1_298, __p2_298) __extension__ ({ \
46337 float16x8_t __ret_298; \
46338 float16x8_t __s0_298 = __p0_298; \
46339 float16x4_t __s1_298 = __p1_298; \
46340 float16x8_t __rev0_298; __rev0_298 = __builtin_shufflevector(__s0_298, __s0_298, 7, 6, 5, 4, 3, 2, 1, 0); \
46341 float16x4_t __rev1_298; __rev1_298 = __builtin_shufflevector(__s1_298, __s1_298, 3, 2, 1, 0); \
46342 __ret_298 = __noswap_vmulxq_f16(__rev0_298, __noswap_splatq_lane_f16(__rev1_298, __p2_298)); \
46343 __ret_298 = __builtin_shufflevector(__ret_298, __ret_298, 7, 6, 5, 4, 3, 2, 1, 0); \
46344 __ret_298; \
46866#define vfmaq_lane_f64(__p0, __p1, __p2, __p3) __extension__ ({ \
46867 float64x2_t __ret; \
46868 float64x2_t __s0 = __p0; \
46869 float64x2_t __s1 = __p1; \
46870 float64x1_t __s2 = __p2; \
46871 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
46872 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
46873 __ret = (float64x2_t) __builtin_neon_vfmaq_lane_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x8_t)__s2, __p3, 42); \
46874 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
46875 __ret; \
46876})
46877#define __noswap_vfmaq_lane_f64(__p0, __p1, __p2, __p3) __extension__ ({ \
46878 float64x2_t __ret; \
46879 float64x2_t __s0 = __p0; \
46880 float64x2_t __s1 = __p1; \
46881 float64x1_t __s2 = __p2; \
46882 __ret = (float64x2_t) __builtin_neon_vfmaq_lane_v((int8x16_t)__s0, (int8x16_t)__s1, (int8x8_t)__s2, __p3, 42); \
46883 __ret; \
4634546884})
4634646885#endif
4634746886
4634846887#ifdef __LITTLE_ENDIAN__
46349#define vmulx_lane_f16(__p0_299, __p1_299, __p2_299) __extension__ ({ \
46350 float16x4_t __ret_299; \
46351 float16x4_t __s0_299 = __p0_299; \
46352 float16x4_t __s1_299 = __p1_299; \
46353 __ret_299 = vmulx_f16(__s0_299, splat_lane_f16(__s1_299, __p2_299)); \
46354 __ret_299; \
46888#define vfmaq_lane_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
46889 float32x4_t __ret; \
46890 float32x4_t __s0 = __p0; \
46891 float32x4_t __s1 = __p1; \
46892 float32x2_t __s2 = __p2; \
46893 __ret = (float32x4_t) __builtin_neon_vfmaq_lane_v((int8x16_t)__s0, (int8x16_t)__s1, (int8x8_t)__s2, __p3, 41); \
46894 __ret; \
4635546895})
4635646896#else
46357#define vmulx_lane_f16(__p0_300, __p1_300, __p2_300) __extension__ ({ \
46358 float16x4_t __ret_300; \
46359 float16x4_t __s0_300 = __p0_300; \
46360 float16x4_t __s1_300 = __p1_300; \
46361 float16x4_t __rev0_300; __rev0_300 = __builtin_shufflevector(__s0_300, __s0_300, 3, 2, 1, 0); \
46362 float16x4_t __rev1_300; __rev1_300 = __builtin_shufflevector(__s1_300, __s1_300, 3, 2, 1, 0); \
46363 __ret_300 = __noswap_vmulx_f16(__rev0_300, __noswap_splat_lane_f16(__rev1_300, __p2_300)); \
46364 __ret_300 = __builtin_shufflevector(__ret_300, __ret_300, 3, 2, 1, 0); \
46365 __ret_300; \
46897#define vfmaq_lane_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
46898 float32x4_t __ret; \
46899 float32x4_t __s0 = __p0; \
46900 float32x4_t __s1 = __p1; \
46901 float32x2_t __s2 = __p2; \
46902 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
46903 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
46904 float32x2_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 1, 0); \
46905 __ret = (float32x4_t) __builtin_neon_vfmaq_lane_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x8_t)__rev2, __p3, 41); \
46906 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
46907 __ret; \
46908})
46909#define __noswap_vfmaq_lane_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
46910 float32x4_t __ret; \
46911 float32x4_t __s0 = __p0; \
46912 float32x4_t __s1 = __p1; \
46913 float32x2_t __s2 = __p2; \
46914 __ret = (float32x4_t) __builtin_neon_vfmaq_lane_v((int8x16_t)__s0, (int8x16_t)__s1, (int8x8_t)__s2, __p3, 41); \
46915 __ret; \
46916})
46917#endif
46918
46919#define vfma_lane_f64(__p0, __p1, __p2, __p3) __extension__ ({ \
46920 float64x1_t __ret; \
46921 float64x1_t __s0 = __p0; \
46922 float64x1_t __s1 = __p1; \
46923 float64x1_t __s2 = __p2; \
46924 __ret = (float64x1_t) __builtin_neon_vfma_lane_v((int8x8_t)__s0, (int8x8_t)__s1, (int8x8_t)__s2, __p3, 10); \
46925 __ret; \
46926})
46927#ifdef __LITTLE_ENDIAN__
46928#define vfma_lane_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
46929 float32x2_t __ret; \
46930 float32x2_t __s0 = __p0; \
46931 float32x2_t __s1 = __p1; \
46932 float32x2_t __s2 = __p2; \
46933 __ret = (float32x2_t) __builtin_neon_vfma_lane_v((int8x8_t)__s0, (int8x8_t)__s1, (int8x8_t)__s2, __p3, 9); \
46934 __ret; \
46935})
46936#else
46937#define vfma_lane_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
46938 float32x2_t __ret; \
46939 float32x2_t __s0 = __p0; \
46940 float32x2_t __s1 = __p1; \
46941 float32x2_t __s2 = __p2; \
46942 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
46943 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
46944 float32x2_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 1, 0); \
46945 __ret = (float32x2_t) __builtin_neon_vfma_lane_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, __p3, 9); \
46946 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
46947 __ret; \
46948})
46949#define __noswap_vfma_lane_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
46950 float32x2_t __ret; \
46951 float32x2_t __s0 = __p0; \
46952 float32x2_t __s1 = __p1; \
46953 float32x2_t __s2 = __p2; \
46954 __ret = (float32x2_t) __builtin_neon_vfma_lane_v((int8x8_t)__s0, (int8x8_t)__s1, (int8x8_t)__s2, __p3, 9); \
46955 __ret; \
46956})
46957#endif
46958
46959#ifdef __LITTLE_ENDIAN__
46960#define vfmad_laneq_f64(__p0, __p1, __p2, __p3) __extension__ ({ \
46961 float64_t __ret; \
46962 float64_t __s0 = __p0; \
46963 float64_t __s1 = __p1; \
46964 float64x2_t __s2 = __p2; \
46965 __ret = (float64_t) __builtin_neon_vfmad_laneq_f64(__s0, __s1, (float64x2_t)__s2, __p3); \
46966 __ret; \
46967})
46968#else
46969#define vfmad_laneq_f64(__p0, __p1, __p2, __p3) __extension__ ({ \
46970 float64_t __ret; \
46971 float64_t __s0 = __p0; \
46972 float64_t __s1 = __p1; \
46973 float64x2_t __s2 = __p2; \
46974 float64x2_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 1, 0); \
46975 __ret = (float64_t) __builtin_neon_vfmad_laneq_f64(__s0, __s1, (float64x2_t)__rev2, __p3); \
46976 __ret; \
46977})
46978#define __noswap_vfmad_laneq_f64(__p0, __p1, __p2, __p3) __extension__ ({ \
46979 float64_t __ret; \
46980 float64_t __s0 = __p0; \
46981 float64_t __s1 = __p1; \
46982 float64x2_t __s2 = __p2; \
46983 __ret = (float64_t) __builtin_neon_vfmad_laneq_f64(__s0, __s1, (float64x2_t)__s2, __p3); \
46984 __ret; \
4636646985})
4636746986#endif
4636846987
4636946988#ifdef __LITTLE_ENDIAN__
46370#define vmulxh_laneq_f16(__p0, __p1, __p2) __extension__ ({ \
46371 float16_t __ret; \
46372 float16_t __s0 = __p0; \
46373 float16x8_t __s1 = __p1; \
46374 __ret = (float16_t) __builtin_neon_vmulxh_laneq_f16(__s0, (float16x8_t)__s1, __p2); \
46989#define vfmas_laneq_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
46990 float32_t __ret; \
46991 float32_t __s0 = __p0; \
46992 float32_t __s1 = __p1; \
46993 float32x4_t __s2 = __p2; \
46994 __ret = (float32_t) __builtin_neon_vfmas_laneq_f32(__s0, __s1, (float32x4_t)__s2, __p3); \
4637546995 __ret; \
4637646996})
4637746997#else
46378#define vmulxh_laneq_f16(__p0, __p1, __p2) __extension__ ({ \
46379 float16_t __ret; \
46380 float16_t __s0 = __p0; \
46381 float16x8_t __s1 = __p1; \
46382 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
46383 __ret = (float16_t) __builtin_neon_vmulxh_laneq_f16(__s0, (float16x8_t)__rev1, __p2); \
46998#define vfmas_laneq_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
46999 float32_t __ret; \
47000 float32_t __s0 = __p0; \
47001 float32_t __s1 = __p1; \
47002 float32x4_t __s2 = __p2; \
47003 float32x4_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 3, 2, 1, 0); \
47004 __ret = (float32_t) __builtin_neon_vfmas_laneq_f32(__s0, __s1, (float32x4_t)__rev2, __p3); \
47005 __ret; \
47006})
47007#define __noswap_vfmas_laneq_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
47008 float32_t __ret; \
47009 float32_t __s0 = __p0; \
47010 float32_t __s1 = __p1; \
47011 float32x4_t __s2 = __p2; \
47012 __ret = (float32_t) __builtin_neon_vfmas_laneq_f32(__s0, __s1, (float32x4_t)__s2, __p3); \
4638447013 __ret; \
4638547014})
4638647015#endif
4638747016
4638847017#ifdef __LITTLE_ENDIAN__
46389#define vmulxq_laneq_f16(__p0_301, __p1_301, __p2_301) __extension__ ({ \
46390 float16x8_t __ret_301; \
46391 float16x8_t __s0_301 = __p0_301; \
46392 float16x8_t __s1_301 = __p1_301; \
46393 __ret_301 = vmulxq_f16(__s0_301, splatq_laneq_f16(__s1_301, __p2_301)); \
46394 __ret_301; \
47018#define vfmaq_laneq_f64(__p0, __p1, __p2, __p3) __extension__ ({ \
47019 float64x2_t __ret; \
47020 float64x2_t __s0 = __p0; \
47021 float64x2_t __s1 = __p1; \
47022 float64x2_t __s2 = __p2; \
47023 __ret = (float64x2_t) __builtin_neon_vfmaq_laneq_v((int8x16_t)__s0, (int8x16_t)__s1, (int8x16_t)__s2, __p3, 42); \
47024 __ret; \
4639547025})
4639647026#else
46397#define vmulxq_laneq_f16(__p0_302, __p1_302, __p2_302) __extension__ ({ \
46398 float16x8_t __ret_302; \
46399 float16x8_t __s0_302 = __p0_302; \
46400 float16x8_t __s1_302 = __p1_302; \
46401 float16x8_t __rev0_302; __rev0_302 = __builtin_shufflevector(__s0_302, __s0_302, 7, 6, 5, 4, 3, 2, 1, 0); \
46402 float16x8_t __rev1_302; __rev1_302 = __builtin_shufflevector(__s1_302, __s1_302, 7, 6, 5, 4, 3, 2, 1, 0); \
46403 __ret_302 = __noswap_vmulxq_f16(__rev0_302, __noswap_splatq_laneq_f16(__rev1_302, __p2_302)); \
46404 __ret_302 = __builtin_shufflevector(__ret_302, __ret_302, 7, 6, 5, 4, 3, 2, 1, 0); \
46405 __ret_302; \
47027#define vfmaq_laneq_f64(__p0, __p1, __p2, __p3) __extension__ ({ \
47028 float64x2_t __ret; \
47029 float64x2_t __s0 = __p0; \
47030 float64x2_t __s1 = __p1; \
47031 float64x2_t __s2 = __p2; \
47032 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
47033 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
47034 float64x2_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 1, 0); \
47035 __ret = (float64x2_t) __builtin_neon_vfmaq_laneq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, __p3, 42); \
47036 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
47037 __ret; \
47038})
47039#define __noswap_vfmaq_laneq_f64(__p0, __p1, __p2, __p3) __extension__ ({ \
47040 float64x2_t __ret; \
47041 float64x2_t __s0 = __p0; \
47042 float64x2_t __s1 = __p1; \
47043 float64x2_t __s2 = __p2; \
47044 __ret = (float64x2_t) __builtin_neon_vfmaq_laneq_v((int8x16_t)__s0, (int8x16_t)__s1, (int8x16_t)__s2, __p3, 42); \
47045 __ret; \
4640647046})
4640747047#endif
4640847048
4640947049#ifdef __LITTLE_ENDIAN__
46410#define vmulx_laneq_f16(__p0_303, __p1_303, __p2_303) __extension__ ({ \
46411 float16x4_t __ret_303; \
46412 float16x4_t __s0_303 = __p0_303; \
46413 float16x8_t __s1_303 = __p1_303; \
46414 __ret_303 = vmulx_f16(__s0_303, splat_laneq_f16(__s1_303, __p2_303)); \
46415 __ret_303; \
47050#define vfmaq_laneq_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
47051 float32x4_t __ret; \
47052 float32x4_t __s0 = __p0; \
47053 float32x4_t __s1 = __p1; \
47054 float32x4_t __s2 = __p2; \
47055 __ret = (float32x4_t) __builtin_neon_vfmaq_laneq_v((int8x16_t)__s0, (int8x16_t)__s1, (int8x16_t)__s2, __p3, 41); \
47056 __ret; \
4641647057})
4641747058#else
46418#define vmulx_laneq_f16(__p0_304, __p1_304, __p2_304) __extension__ ({ \
46419 float16x4_t __ret_304; \
46420 float16x4_t __s0_304 = __p0_304; \
46421 float16x8_t __s1_304 = __p1_304; \
46422 float16x4_t __rev0_304; __rev0_304 = __builtin_shufflevector(__s0_304, __s0_304, 3, 2, 1, 0); \
46423 float16x8_t __rev1_304; __rev1_304 = __builtin_shufflevector(__s1_304, __s1_304, 7, 6, 5, 4, 3, 2, 1, 0); \
46424 __ret_304 = __noswap_vmulx_f16(__rev0_304, __noswap_splat_laneq_f16(__rev1_304, __p2_304)); \
46425 __ret_304 = __builtin_shufflevector(__ret_304, __ret_304, 3, 2, 1, 0); \
46426 __ret_304; \
47059#define vfmaq_laneq_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
47060 float32x4_t __ret; \
47061 float32x4_t __s0 = __p0; \
47062 float32x4_t __s1 = __p1; \
47063 float32x4_t __s2 = __p2; \
47064 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
47065 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
47066 float32x4_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 3, 2, 1, 0); \
47067 __ret = (float32x4_t) __builtin_neon_vfmaq_laneq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, __p3, 41); \
47068 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
47069 __ret; \
47070})
47071#define __noswap_vfmaq_laneq_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
47072 float32x4_t __ret; \
47073 float32x4_t __s0 = __p0; \
47074 float32x4_t __s1 = __p1; \
47075 float32x4_t __s2 = __p2; \
47076 __ret = (float32x4_t) __builtin_neon_vfmaq_laneq_v((int8x16_t)__s0, (int8x16_t)__s1, (int8x16_t)__s2, __p3, 41); \
47077 __ret; \
4642747078})
4642847079#endif
4642947080
4643047081#ifdef __LITTLE_ENDIAN__
46431#define vmulxq_n_f16(__p0, __p1) __extension__ ({ \
46432 float16x8_t __ret; \
46433 float16x8_t __s0 = __p0; \
46434 float16_t __s1 = __p1; \
46435 __ret = vmulxq_f16(__s0, (float16x8_t) {__s1, __s1, __s1, __s1, __s1, __s1, __s1, __s1}); \
47082#define vfma_laneq_f64(__p0, __p1, __p2, __p3) __extension__ ({ \
47083 float64x1_t __ret; \
47084 float64x1_t __s0 = __p0; \
47085 float64x1_t __s1 = __p1; \
47086 float64x2_t __s2 = __p2; \
47087 __ret = (float64x1_t) __builtin_neon_vfma_laneq_v((int8x8_t)__s0, (int8x8_t)__s1, (int8x16_t)__s2, __p3, 10); \
4643647088 __ret; \
4643747089})
4643847090#else
46439#define vmulxq_n_f16(__p0, __p1) __extension__ ({ \
46440 float16x8_t __ret; \
46441 float16x8_t __s0 = __p0; \
46442 float16_t __s1 = __p1; \
46443 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
46444 __ret = __noswap_vmulxq_f16(__rev0, (float16x8_t) {__s1, __s1, __s1, __s1, __s1, __s1, __s1, __s1}); \
46445 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
47091#define vfma_laneq_f64(__p0, __p1, __p2, __p3) __extension__ ({ \
47092 float64x1_t __ret; \
47093 float64x1_t __s0 = __p0; \
47094 float64x1_t __s1 = __p1; \
47095 float64x2_t __s2 = __p2; \
47096 float64x2_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 1, 0); \
47097 __ret = (float64x1_t) __builtin_neon_vfma_laneq_v((int8x8_t)__s0, (int8x8_t)__s1, (int8x16_t)__rev2, __p3, 10); \
47098 __ret; \
47099})
47100#define __noswap_vfma_laneq_f64(__p0, __p1, __p2, __p3) __extension__ ({ \
47101 float64x1_t __ret; \
47102 float64x1_t __s0 = __p0; \
47103 float64x1_t __s1 = __p1; \
47104 float64x2_t __s2 = __p2; \
47105 __ret = (float64x1_t) __builtin_neon_vfma_laneq_v((int8x8_t)__s0, (int8x8_t)__s1, (int8x16_t)__s2, __p3, 10); \
4644647106 __ret; \
4644747107})
4644847108#endif
4644947109
4645047110#ifdef __LITTLE_ENDIAN__
46451#define vmulx_n_f16(__p0, __p1) __extension__ ({ \
46452 float16x4_t __ret; \
46453 float16x4_t __s0 = __p0; \
46454 float16_t __s1 = __p1; \
46455 __ret = vmulx_f16(__s0, (float16x4_t) {__s1, __s1, __s1, __s1}); \
47111#define vfma_laneq_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
47112 float32x2_t __ret; \
47113 float32x2_t __s0 = __p0; \
47114 float32x2_t __s1 = __p1; \
47115 float32x4_t __s2 = __p2; \
47116 __ret = (float32x2_t) __builtin_neon_vfma_laneq_v((int8x8_t)__s0, (int8x8_t)__s1, (int8x16_t)__s2, __p3, 9); \
4645647117 __ret; \
4645747118})
4645847119#else
46459#define vmulx_n_f16(__p0, __p1) __extension__ ({ \
46460 float16x4_t __ret; \
46461 float16x4_t __s0 = __p0; \
46462 float16_t __s1 = __p1; \
46463 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
46464 __ret = __noswap_vmulx_f16(__rev0, (float16x4_t) {__s1, __s1, __s1, __s1}); \
46465 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
47120#define vfma_laneq_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
47121 float32x2_t __ret; \
47122 float32x2_t __s0 = __p0; \
47123 float32x2_t __s1 = __p1; \
47124 float32x4_t __s2 = __p2; \
47125 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
47126 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
47127 float32x4_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 3, 2, 1, 0); \
47128 __ret = (float32x2_t) __builtin_neon_vfma_laneq_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x16_t)__rev2, __p3, 9); \
47129 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
47130 __ret; \
47131})
47132#define __noswap_vfma_laneq_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
47133 float32x2_t __ret; \
47134 float32x2_t __s0 = __p0; \
47135 float32x2_t __s1 = __p1; \
47136 float32x4_t __s2 = __p2; \
47137 __ret = (float32x2_t) __builtin_neon_vfma_laneq_v((int8x8_t)__s0, (int8x8_t)__s1, (int8x16_t)__s2, __p3, 9); \
4646647138 __ret; \
4646747139})
4646847140#endif
4646947141
4647047142#ifdef __LITTLE_ENDIAN__
46471__ai float16x8_t vpaddq_f16(float16x8_t __p0, float16x8_t __p1) {
46472 float16x8_t __ret;
46473 __ret = (float16x8_t) __builtin_neon_vpaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 40);
47143__ai float64x2_t vfmaq_n_f64(float64x2_t __p0, float64x2_t __p1, float64_t __p2) {
47144 float64x2_t __ret;
47145 __ret = vfmaq_f64(__p0, __p1, (float64x2_t) {__p2, __p2});
4647447146 return __ret;
4647547147}
4647647148#else
46477__ai float16x8_t vpaddq_f16(float16x8_t __p0, float16x8_t __p1) {
46478 float16x8_t __ret;
46479 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
46480 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
46481 __ret = (float16x8_t) __builtin_neon_vpaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
46482 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
47149__ai float64x2_t vfmaq_n_f64(float64x2_t __p0, float64x2_t __p1, float64_t __p2) {
47150 float64x2_t __ret;
47151 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
47152 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
47153 __ret = __noswap_vfmaq_f64(__rev0, __rev1, (float64x2_t) {__p2, __p2});
47154 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4648347155 return __ret;
4648447156}
4648547157#endif
4648647158
46487#ifdef __LITTLE_ENDIAN__
46488__ai float16x8_t vpmaxq_f16(float16x8_t __p0, float16x8_t __p1) {
46489 float16x8_t __ret;
46490 __ret = (float16x8_t) __builtin_neon_vpmaxq_v((int8x16_t)__p0, (int8x16_t)__p1, 40);
46491 return __ret;
46492}
46493#else
46494__ai float16x8_t vpmaxq_f16(float16x8_t __p0, float16x8_t __p1) {
46495 float16x8_t __ret;
46496 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
46497 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
46498 __ret = (float16x8_t) __builtin_neon_vpmaxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
46499 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
47159__ai float64x1_t vfma_n_f64(float64x1_t __p0, float64x1_t __p1, float64_t __p2) {
47160 float64x1_t __ret;
47161 __ret = vfma_f64(__p0, __p1, (float64x1_t) {__p2});
4650047162 return __ret;
4650147163}
46502#endif
46503
4650447164#ifdef __LITTLE_ENDIAN__
46505__ai float16x8_t vpmaxnmq_f16(float16x8_t __p0, float16x8_t __p1) {
46506 float16x8_t __ret;
46507 __ret = (float16x8_t) __builtin_neon_vpmaxnmq_v((int8x16_t)__p0, (int8x16_t)__p1, 40);
47165__ai float64x2_t vfmsq_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
47166 float64x2_t __ret;
47167 __ret = vfmaq_f64(__p0, -__p1, __p2);
4650847168 return __ret;
4650947169}
4651047170#else
46511__ai float16x8_t vpmaxnmq_f16(float16x8_t __p0, float16x8_t __p1) {
46512 float16x8_t __ret;
46513 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
46514 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
46515 __ret = (float16x8_t) __builtin_neon_vpmaxnmq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
46516 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
47171__ai float64x2_t vfmsq_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
47172 float64x2_t __ret;
47173 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
47174 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
47175 float64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
47176 __ret = __noswap_vfmaq_f64(__rev0, -__rev1, __rev2);
47177 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4651747178 return __ret;
4651847179}
4651947180#endif
4652047181
46521#ifdef __LITTLE_ENDIAN__
46522__ai float16x4_t vpmaxnm_f16(float16x4_t __p0, float16x4_t __p1) {
46523 float16x4_t __ret;
46524 __ret = (float16x4_t) __builtin_neon_vpmaxnm_v((int8x8_t)__p0, (int8x8_t)__p1, 8);
47182__ai float64x1_t vfms_f64(float64x1_t __p0, float64x1_t __p1, float64x1_t __p2) {
47183 float64x1_t __ret;
47184 __ret = vfma_f64(__p0, -__p1, __p2);
4652547185 return __ret;
4652647186}
47187#define vfmsd_lane_f64(__p0_405, __p1_405, __p2_405, __p3_405) __extension__ ({ \
47188 float64_t __ret_405; \
47189 float64_t __s0_405 = __p0_405; \
47190 float64_t __s1_405 = __p1_405; \
47191 float64x1_t __s2_405 = __p2_405; \
47192 __ret_405 = vfmad_lane_f64(__s0_405, -__s1_405, __s2_405, __p3_405); \
47193 __ret_405; \
47194})
47195#ifdef __LITTLE_ENDIAN__
47196#define vfmss_lane_f32(__p0_406, __p1_406, __p2_406, __p3_406) __extension__ ({ \
47197 float32_t __ret_406; \
47198 float32_t __s0_406 = __p0_406; \
47199 float32_t __s1_406 = __p1_406; \
47200 float32x2_t __s2_406 = __p2_406; \
47201 __ret_406 = vfmas_lane_f32(__s0_406, -__s1_406, __s2_406, __p3_406); \
47202 __ret_406; \
47203})
4652747204#else
46528__ai float16x4_t vpmaxnm_f16(float16x4_t __p0, float16x4_t __p1) {
46529 float16x4_t __ret;
46530 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
46531 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
46532 __ret = (float16x4_t) __builtin_neon_vpmaxnm_v((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
46533 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
46534 return __ret;
46535}
47205#define vfmss_lane_f32(__p0_407, __p1_407, __p2_407, __p3_407) __extension__ ({ \
47206 float32_t __ret_407; \
47207 float32_t __s0_407 = __p0_407; \
47208 float32_t __s1_407 = __p1_407; \
47209 float32x2_t __s2_407 = __p2_407; \
47210 float32x2_t __rev2_407; __rev2_407 = __builtin_shufflevector(__s2_407, __s2_407, 1, 0); \
47211 __ret_407 = __noswap_vfmas_lane_f32(__s0_407, -__s1_407, __rev2_407, __p3_407); \
47212 __ret_407; \
47213})
4653647214#endif
4653747215
4653847216#ifdef __LITTLE_ENDIAN__
46539__ai float16x8_t vpminq_f16(float16x8_t __p0, float16x8_t __p1) {
46540 float16x8_t __ret;
46541 __ret = (float16x8_t) __builtin_neon_vpminq_v((int8x16_t)__p0, (int8x16_t)__p1, 40);
46542 return __ret;
46543}
47217#define vfmsq_lane_f64(__p0_408, __p1_408, __p2_408, __p3_408) __extension__ ({ \
47218 float64x2_t __ret_408; \
47219 float64x2_t __s0_408 = __p0_408; \
47220 float64x2_t __s1_408 = __p1_408; \
47221 float64x1_t __s2_408 = __p2_408; \
47222 __ret_408 = vfmaq_lane_f64(__s0_408, -__s1_408, __s2_408, __p3_408); \
47223 __ret_408; \
47224})
4654447225#else
46545__ai float16x8_t vpminq_f16(float16x8_t __p0, float16x8_t __p1) {
46546 float16x8_t __ret;
46547 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
46548 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
46549 __ret = (float16x8_t) __builtin_neon_vpminq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
46550 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
46551 return __ret;
46552}
47226#define vfmsq_lane_f64(__p0_409, __p1_409, __p2_409, __p3_409) __extension__ ({ \
47227 float64x2_t __ret_409; \
47228 float64x2_t __s0_409 = __p0_409; \
47229 float64x2_t __s1_409 = __p1_409; \
47230 float64x1_t __s2_409 = __p2_409; \
47231 float64x2_t __rev0_409; __rev0_409 = __builtin_shufflevector(__s0_409, __s0_409, 1, 0); \
47232 float64x2_t __rev1_409; __rev1_409 = __builtin_shufflevector(__s1_409, __s1_409, 1, 0); \
47233 __ret_409 = __noswap_vfmaq_lane_f64(__rev0_409, -__rev1_409, __s2_409, __p3_409); \
47234 __ret_409 = __builtin_shufflevector(__ret_409, __ret_409, 1, 0); \
47235 __ret_409; \
47236})
4655347237#endif
4655447238
4655547239#ifdef __LITTLE_ENDIAN__
46556__ai float16x8_t vpminnmq_f16(float16x8_t __p0, float16x8_t __p1) {
46557 float16x8_t __ret;
46558 __ret = (float16x8_t) __builtin_neon_vpminnmq_v((int8x16_t)__p0, (int8x16_t)__p1, 40);
46559 return __ret;
46560}
47240#define vfmsq_lane_f32(__p0_410, __p1_410, __p2_410, __p3_410) __extension__ ({ \
47241 float32x4_t __ret_410; \
47242 float32x4_t __s0_410 = __p0_410; \
47243 float32x4_t __s1_410 = __p1_410; \
47244 float32x2_t __s2_410 = __p2_410; \
47245 __ret_410 = vfmaq_lane_f32(__s0_410, -__s1_410, __s2_410, __p3_410); \
47246 __ret_410; \
47247})
4656147248#else
46562__ai float16x8_t vpminnmq_f16(float16x8_t __p0, float16x8_t __p1) {
46563 float16x8_t __ret;
46564 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
46565 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
46566 __ret = (float16x8_t) __builtin_neon_vpminnmq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
46567 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
46568 return __ret;
46569}
47249#define vfmsq_lane_f32(__p0_411, __p1_411, __p2_411, __p3_411) __extension__ ({ \
47250 float32x4_t __ret_411; \
47251 float32x4_t __s0_411 = __p0_411; \
47252 float32x4_t __s1_411 = __p1_411; \
47253 float32x2_t __s2_411 = __p2_411; \
47254 float32x4_t __rev0_411; __rev0_411 = __builtin_shufflevector(__s0_411, __s0_411, 3, 2, 1, 0); \
47255 float32x4_t __rev1_411; __rev1_411 = __builtin_shufflevector(__s1_411, __s1_411, 3, 2, 1, 0); \
47256 float32x2_t __rev2_411; __rev2_411 = __builtin_shufflevector(__s2_411, __s2_411, 1, 0); \
47257 __ret_411 = __noswap_vfmaq_lane_f32(__rev0_411, -__rev1_411, __rev2_411, __p3_411); \
47258 __ret_411 = __builtin_shufflevector(__ret_411, __ret_411, 3, 2, 1, 0); \
47259 __ret_411; \
47260})
4657047261#endif
4657147262
47263#define vfms_lane_f64(__p0_412, __p1_412, __p2_412, __p3_412) __extension__ ({ \
47264 float64x1_t __ret_412; \
47265 float64x1_t __s0_412 = __p0_412; \
47266 float64x1_t __s1_412 = __p1_412; \
47267 float64x1_t __s2_412 = __p2_412; \
47268 __ret_412 = vfma_lane_f64(__s0_412, -__s1_412, __s2_412, __p3_412); \
47269 __ret_412; \
47270})
4657247271#ifdef __LITTLE_ENDIAN__
46573__ai float16x4_t vpminnm_f16(float16x4_t __p0, float16x4_t __p1) {
46574 float16x4_t __ret;
46575 __ret = (float16x4_t) __builtin_neon_vpminnm_v((int8x8_t)__p0, (int8x8_t)__p1, 8);
46576 return __ret;
46577}
47272#define vfms_lane_f32(__p0_413, __p1_413, __p2_413, __p3_413) __extension__ ({ \
47273 float32x2_t __ret_413; \
47274 float32x2_t __s0_413 = __p0_413; \
47275 float32x2_t __s1_413 = __p1_413; \
47276 float32x2_t __s2_413 = __p2_413; \
47277 __ret_413 = vfma_lane_f32(__s0_413, -__s1_413, __s2_413, __p3_413); \
47278 __ret_413; \
47279})
4657847280#else
46579__ai float16x4_t vpminnm_f16(float16x4_t __p0, float16x4_t __p1) {
46580 float16x4_t __ret;
46581 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
46582 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
46583 __ret = (float16x4_t) __builtin_neon_vpminnm_v((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
46584 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
46585 return __ret;
46586}
47281#define vfms_lane_f32(__p0_414, __p1_414, __p2_414, __p3_414) __extension__ ({ \
47282 float32x2_t __ret_414; \
47283 float32x2_t __s0_414 = __p0_414; \
47284 float32x2_t __s1_414 = __p1_414; \
47285 float32x2_t __s2_414 = __p2_414; \
47286 float32x2_t __rev0_414; __rev0_414 = __builtin_shufflevector(__s0_414, __s0_414, 1, 0); \
47287 float32x2_t __rev1_414; __rev1_414 = __builtin_shufflevector(__s1_414, __s1_414, 1, 0); \
47288 float32x2_t __rev2_414; __rev2_414 = __builtin_shufflevector(__s2_414, __s2_414, 1, 0); \
47289 __ret_414 = __noswap_vfma_lane_f32(__rev0_414, -__rev1_414, __rev2_414, __p3_414); \
47290 __ret_414 = __builtin_shufflevector(__ret_414, __ret_414, 1, 0); \
47291 __ret_414; \
47292})
4658747293#endif
4658847294
4658947295#ifdef __LITTLE_ENDIAN__
46590__ai float16x8_t vrndiq_f16(float16x8_t __p0) {
46591 float16x8_t __ret;
46592 __ret = (float16x8_t) __builtin_neon_vrndiq_v((int8x16_t)__p0, 40);
46593 return __ret;
46594}
47296#define vfmsd_laneq_f64(__p0_415, __p1_415, __p2_415, __p3_415) __extension__ ({ \
47297 float64_t __ret_415; \
47298 float64_t __s0_415 = __p0_415; \
47299 float64_t __s1_415 = __p1_415; \
47300 float64x2_t __s2_415 = __p2_415; \
47301 __ret_415 = vfmad_laneq_f64(__s0_415, -__s1_415, __s2_415, __p3_415); \
47302 __ret_415; \
47303})
4659547304#else
46596__ai float16x8_t vrndiq_f16(float16x8_t __p0) {
46597 float16x8_t __ret;
46598 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
46599 __ret = (float16x8_t) __builtin_neon_vrndiq_v((int8x16_t)__rev0, 40);
46600 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
46601 return __ret;
46602}
47305#define vfmsd_laneq_f64(__p0_416, __p1_416, __p2_416, __p3_416) __extension__ ({ \
47306 float64_t __ret_416; \
47307 float64_t __s0_416 = __p0_416; \
47308 float64_t __s1_416 = __p1_416; \
47309 float64x2_t __s2_416 = __p2_416; \
47310 float64x2_t __rev2_416; __rev2_416 = __builtin_shufflevector(__s2_416, __s2_416, 1, 0); \
47311 __ret_416 = __noswap_vfmad_laneq_f64(__s0_416, -__s1_416, __rev2_416, __p3_416); \
47312 __ret_416; \
47313})
4660347314#endif
4660447315
4660547316#ifdef __LITTLE_ENDIAN__
46606__ai float16x4_t vrndi_f16(float16x4_t __p0) {
46607 float16x4_t __ret;
46608 __ret = (float16x4_t) __builtin_neon_vrndi_v((int8x8_t)__p0, 8);
46609 return __ret;
46610}
47317#define vfmss_laneq_f32(__p0_417, __p1_417, __p2_417, __p3_417) __extension__ ({ \
47318 float32_t __ret_417; \
47319 float32_t __s0_417 = __p0_417; \
47320 float32_t __s1_417 = __p1_417; \
47321 float32x4_t __s2_417 = __p2_417; \
47322 __ret_417 = vfmas_laneq_f32(__s0_417, -__s1_417, __s2_417, __p3_417); \
47323 __ret_417; \
47324})
4661147325#else
46612__ai float16x4_t vrndi_f16(float16x4_t __p0) {
46613 float16x4_t __ret;
46614 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
46615 __ret = (float16x4_t) __builtin_neon_vrndi_v((int8x8_t)__rev0, 8);
46616 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
46617 return __ret;
46618}
47326#define vfmss_laneq_f32(__p0_418, __p1_418, __p2_418, __p3_418) __extension__ ({ \
47327 float32_t __ret_418; \
47328 float32_t __s0_418 = __p0_418; \
47329 float32_t __s1_418 = __p1_418; \
47330 float32x4_t __s2_418 = __p2_418; \
47331 float32x4_t __rev2_418; __rev2_418 = __builtin_shufflevector(__s2_418, __s2_418, 3, 2, 1, 0); \
47332 __ret_418 = __noswap_vfmas_laneq_f32(__s0_418, -__s1_418, __rev2_418, __p3_418); \
47333 __ret_418; \
47334})
4661947335#endif
4662047336
4662147337#ifdef __LITTLE_ENDIAN__
46622__ai float16x8_t vsqrtq_f16(float16x8_t __p0) {
46623 float16x8_t __ret;
46624 __ret = (float16x8_t) __builtin_neon_vsqrtq_v((int8x16_t)__p0, 40);
46625 return __ret;
46626}
47338#define vfmsq_laneq_f64(__p0_419, __p1_419, __p2_419, __p3_419) __extension__ ({ \
47339 float64x2_t __ret_419; \
47340 float64x2_t __s0_419 = __p0_419; \
47341 float64x2_t __s1_419 = __p1_419; \
47342 float64x2_t __s2_419 = __p2_419; \
47343 __ret_419 = vfmaq_laneq_f64(__s0_419, -__s1_419, __s2_419, __p3_419); \
47344 __ret_419; \
47345})
4662747346#else
46628__ai float16x8_t vsqrtq_f16(float16x8_t __p0) {
46629 float16x8_t __ret;
46630 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
46631 __ret = (float16x8_t) __builtin_neon_vsqrtq_v((int8x16_t)__rev0, 40);
46632 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
46633 return __ret;
46634}
47347#define vfmsq_laneq_f64(__p0_420, __p1_420, __p2_420, __p3_420) __extension__ ({ \
47348 float64x2_t __ret_420; \
47349 float64x2_t __s0_420 = __p0_420; \
47350 float64x2_t __s1_420 = __p1_420; \
47351 float64x2_t __s2_420 = __p2_420; \
47352 float64x2_t __rev0_420; __rev0_420 = __builtin_shufflevector(__s0_420, __s0_420, 1, 0); \
47353 float64x2_t __rev1_420; __rev1_420 = __builtin_shufflevector(__s1_420, __s1_420, 1, 0); \
47354 float64x2_t __rev2_420; __rev2_420 = __builtin_shufflevector(__s2_420, __s2_420, 1, 0); \
47355 __ret_420 = __noswap_vfmaq_laneq_f64(__rev0_420, -__rev1_420, __rev2_420, __p3_420); \
47356 __ret_420 = __builtin_shufflevector(__ret_420, __ret_420, 1, 0); \
47357 __ret_420; \
47358})
4663547359#endif
4663647360
4663747361#ifdef __LITTLE_ENDIAN__
46638__ai float16x4_t vsqrt_f16(float16x4_t __p0) {
46639 float16x4_t __ret;
46640 __ret = (float16x4_t) __builtin_neon_vsqrt_v((int8x8_t)__p0, 8);
46641 return __ret;
46642}
47362#define vfmsq_laneq_f32(__p0_421, __p1_421, __p2_421, __p3_421) __extension__ ({ \
47363 float32x4_t __ret_421; \
47364 float32x4_t __s0_421 = __p0_421; \
47365 float32x4_t __s1_421 = __p1_421; \
47366 float32x4_t __s2_421 = __p2_421; \
47367 __ret_421 = vfmaq_laneq_f32(__s0_421, -__s1_421, __s2_421, __p3_421); \
47368 __ret_421; \
47369})
4664347370#else
46644__ai float16x4_t vsqrt_f16(float16x4_t __p0) {
46645 float16x4_t __ret;
46646 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
46647 __ret = (float16x4_t) __builtin_neon_vsqrt_v((int8x8_t)__rev0, 8);
46648 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
46649 return __ret;
46650}
47371#define vfmsq_laneq_f32(__p0_422, __p1_422, __p2_422, __p3_422) __extension__ ({ \
47372 float32x4_t __ret_422; \
47373 float32x4_t __s0_422 = __p0_422; \
47374 float32x4_t __s1_422 = __p1_422; \
47375 float32x4_t __s2_422 = __p2_422; \
47376 float32x4_t __rev0_422; __rev0_422 = __builtin_shufflevector(__s0_422, __s0_422, 3, 2, 1, 0); \
47377 float32x4_t __rev1_422; __rev1_422 = __builtin_shufflevector(__s1_422, __s1_422, 3, 2, 1, 0); \
47378 float32x4_t __rev2_422; __rev2_422 = __builtin_shufflevector(__s2_422, __s2_422, 3, 2, 1, 0); \
47379 __ret_422 = __noswap_vfmaq_laneq_f32(__rev0_422, -__rev1_422, __rev2_422, __p3_422); \
47380 __ret_422 = __builtin_shufflevector(__ret_422, __ret_422, 3, 2, 1, 0); \
47381 __ret_422; \
47382})
4665147383#endif
4665247384
4665347385#ifdef __LITTLE_ENDIAN__
46654__ai float16x8_t vtrn1q_f16(float16x8_t __p0, float16x8_t __p1) {
46655 float16x8_t __ret;
46656 __ret = __builtin_shufflevector(__p0, __p1, 0, 8, 2, 10, 4, 12, 6, 14);
46657 return __ret;
46658}
47386#define vfms_laneq_f64(__p0_423, __p1_423, __p2_423, __p3_423) __extension__ ({ \
47387 float64x1_t __ret_423; \
47388 float64x1_t __s0_423 = __p0_423; \
47389 float64x1_t __s1_423 = __p1_423; \
47390 float64x2_t __s2_423 = __p2_423; \
47391 __ret_423 = vfma_laneq_f64(__s0_423, -__s1_423, __s2_423, __p3_423); \
47392 __ret_423; \
47393})
4665947394#else
46660__ai float16x8_t vtrn1q_f16(float16x8_t __p0, float16x8_t __p1) {
46661 float16x8_t __ret;
46662 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
46663 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
46664 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 8, 2, 10, 4, 12, 6, 14);
46665 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
46666 return __ret;
46667}
47395#define vfms_laneq_f64(__p0_424, __p1_424, __p2_424, __p3_424) __extension__ ({ \
47396 float64x1_t __ret_424; \
47397 float64x1_t __s0_424 = __p0_424; \
47398 float64x1_t __s1_424 = __p1_424; \
47399 float64x2_t __s2_424 = __p2_424; \
47400 float64x2_t __rev2_424; __rev2_424 = __builtin_shufflevector(__s2_424, __s2_424, 1, 0); \
47401 __ret_424 = __noswap_vfma_laneq_f64(__s0_424, -__s1_424, __rev2_424, __p3_424); \
47402 __ret_424; \
47403})
4666847404#endif
4666947405
4667047406#ifdef __LITTLE_ENDIAN__
46671__ai float16x4_t vtrn1_f16(float16x4_t __p0, float16x4_t __p1) {
46672 float16x4_t __ret;
46673 __ret = __builtin_shufflevector(__p0, __p1, 0, 4, 2, 6);
46674 return __ret;
46675}
47407#define vfms_laneq_f32(__p0_425, __p1_425, __p2_425, __p3_425) __extension__ ({ \
47408 float32x2_t __ret_425; \
47409 float32x2_t __s0_425 = __p0_425; \
47410 float32x2_t __s1_425 = __p1_425; \
47411 float32x4_t __s2_425 = __p2_425; \
47412 __ret_425 = vfma_laneq_f32(__s0_425, -__s1_425, __s2_425, __p3_425); \
47413 __ret_425; \
47414})
4667647415#else
46677__ai float16x4_t vtrn1_f16(float16x4_t __p0, float16x4_t __p1) {
46678 float16x4_t __ret;
46679 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
46680 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
46681 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 4, 2, 6);
46682 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
46683 return __ret;
46684}
47416#define vfms_laneq_f32(__p0_426, __p1_426, __p2_426, __p3_426) __extension__ ({ \
47417 float32x2_t __ret_426; \
47418 float32x2_t __s0_426 = __p0_426; \
47419 float32x2_t __s1_426 = __p1_426; \
47420 float32x4_t __s2_426 = __p2_426; \
47421 float32x2_t __rev0_426; __rev0_426 = __builtin_shufflevector(__s0_426, __s0_426, 1, 0); \
47422 float32x2_t __rev1_426; __rev1_426 = __builtin_shufflevector(__s1_426, __s1_426, 1, 0); \
47423 float32x4_t __rev2_426; __rev2_426 = __builtin_shufflevector(__s2_426, __s2_426, 3, 2, 1, 0); \
47424 __ret_426 = __noswap_vfma_laneq_f32(__rev0_426, -__rev1_426, __rev2_426, __p3_426); \
47425 __ret_426 = __builtin_shufflevector(__ret_426, __ret_426, 1, 0); \
47426 __ret_426; \
47427})
4668547428#endif
4668647429
4668747430#ifdef __LITTLE_ENDIAN__
46688__ai float16x8_t vtrn2q_f16(float16x8_t __p0, float16x8_t __p1) {
46689 float16x8_t __ret;
46690 __ret = __builtin_shufflevector(__p0, __p1, 1, 9, 3, 11, 5, 13, 7, 15);
47431__ai float64x2_t vfmsq_n_f64(float64x2_t __p0, float64x2_t __p1, float64_t __p2) {
47432 float64x2_t __ret;
47433 __ret = vfmaq_f64(__p0, -__p1, (float64x2_t) {__p2, __p2});
4669147434 return __ret;
4669247435}
4669347436#else
46694__ai float16x8_t vtrn2q_f16(float16x8_t __p0, float16x8_t __p1) {
46695 float16x8_t __ret;
46696 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
46697 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
46698 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 9, 3, 11, 5, 13, 7, 15);
46699 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
47437__ai float64x2_t vfmsq_n_f64(float64x2_t __p0, float64x2_t __p1, float64_t __p2) {
47438 float64x2_t __ret;
47439 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
47440 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
47441 __ret = __noswap_vfmaq_f64(__rev0, -__rev1, (float64x2_t) {__p2, __p2});
47442 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4670047443 return __ret;
4670147444}
4670247445#endif
4670347446
4670447447#ifdef __LITTLE_ENDIAN__
46705__ai float16x4_t vtrn2_f16(float16x4_t __p0, float16x4_t __p1) {
46706 float16x4_t __ret;
46707 __ret = __builtin_shufflevector(__p0, __p1, 1, 5, 3, 7);
47448__ai float32x4_t vfmsq_n_f32(float32x4_t __p0, float32x4_t __p1, float32_t __p2) {
47449 float32x4_t __ret;
47450 __ret = vfmaq_f32(__p0, -__p1, (float32x4_t) {__p2, __p2, __p2, __p2});
4670847451 return __ret;
4670947452}
4671047453#else
46711__ai float16x4_t vtrn2_f16(float16x4_t __p0, float16x4_t __p1) {
46712 float16x4_t __ret;
46713 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
46714 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
46715 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 5, 3, 7);
47454__ai float32x4_t vfmsq_n_f32(float32x4_t __p0, float32x4_t __p1, float32_t __p2) {
47455 float32x4_t __ret;
47456 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
47457 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
47458 __ret = __noswap_vfmaq_f32(__rev0, -__rev1, (float32x4_t) {__p2, __p2, __p2, __p2});
4671647459 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
4671747460 return __ret;
4671847461}
4671947462#endif
4672047463
46721#ifdef __LITTLE_ENDIAN__
46722__ai float16x8_t vuzp1q_f16(float16x8_t __p0, float16x8_t __p1) {
46723 float16x8_t __ret;
46724 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6, 8, 10, 12, 14);
46725 return __ret;
46726}
46727#else
46728__ai float16x8_t vuzp1q_f16(float16x8_t __p0, float16x8_t __p1) {
46729 float16x8_t __ret;
46730 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
46731 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
46732 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6, 8, 10, 12, 14);
46733 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
47464__ai float64x1_t vfms_n_f64(float64x1_t __p0, float64x1_t __p1, float64_t __p2) {
47465 float64x1_t __ret;
47466 __ret = vfma_f64(__p0, -__p1, (float64x1_t) {__p2});
4673447467 return __ret;
4673547468}
46736#endif
46737
4673847469#ifdef __LITTLE_ENDIAN__
46739__ai float16x4_t vuzp1_f16(float16x4_t __p0, float16x4_t __p1) {
46740 float16x4_t __ret;
46741 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6);
47470__ai float32x2_t vfms_n_f32(float32x2_t __p0, float32x2_t __p1, float32_t __p2) {
47471 float32x2_t __ret;
47472 __ret = vfma_f32(__p0, -__p1, (float32x2_t) {__p2, __p2});
4674247473 return __ret;
4674347474}
4674447475#else
46745__ai float16x4_t vuzp1_f16(float16x4_t __p0, float16x4_t __p1) {
46746 float16x4_t __ret;
46747 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
46748 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
46749 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6);
46750 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
47476__ai float32x2_t vfms_n_f32(float32x2_t __p0, float32x2_t __p1, float32_t __p2) {
47477 float32x2_t __ret;
47478 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
47479 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
47480 __ret = __noswap_vfma_f32(__rev0, -__rev1, (float32x2_t) {__p2, __p2});
47481 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4675147482 return __ret;
4675247483}
4675347484#endif
4675447485
4675547486#ifdef __LITTLE_ENDIAN__
46756__ai float16x8_t vuzp2q_f16(float16x8_t __p0, float16x8_t __p1) {
46757 float16x8_t __ret;
46758 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7, 9, 11, 13, 15);
47487__ai poly64x1_t vget_high_p64(poly64x2_t __p0) {
47488 poly64x1_t __ret;
47489 __ret = __builtin_shufflevector(__p0, __p0, 1);
4675947490 return __ret;
4676047491}
4676147492#else
46762__ai float16x8_t vuzp2q_f16(float16x8_t __p0, float16x8_t __p1) {
46763 float16x8_t __ret;
46764 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
46765 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
46766 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7, 9, 11, 13, 15);
46767 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
46768 return __ret;
46769}
46770#endif
46771
46772#ifdef __LITTLE_ENDIAN__
46773__ai float16x4_t vuzp2_f16(float16x4_t __p0, float16x4_t __p1) {
46774 float16x4_t __ret;
46775 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7);
47493__ai poly64x1_t vget_high_p64(poly64x2_t __p0) {
47494 poly64x1_t __ret;
47495 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
47496 __ret = __builtin_shufflevector(__rev0, __rev0, 1);
4677647497 return __ret;
4677747498}
46778#else
46779__ai float16x4_t vuzp2_f16(float16x4_t __p0, float16x4_t __p1) {
46780 float16x4_t __ret;
46781 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
46782 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
46783 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7);
46784 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
47499__ai poly64x1_t __noswap_vget_high_p64(poly64x2_t __p0) {
47500 poly64x1_t __ret;
47501 __ret = __builtin_shufflevector(__p0, __p0, 1);
4678547502 return __ret;
4678647503}
4678747504#endif
4678847505
4678947506#ifdef __LITTLE_ENDIAN__
46790__ai float16x8_t vzip1q_f16(float16x8_t __p0, float16x8_t __p1) {
46791 float16x8_t __ret;
46792 __ret = __builtin_shufflevector(__p0, __p1, 0, 8, 1, 9, 2, 10, 3, 11);
47507__ai float64x1_t vget_high_f64(float64x2_t __p0) {
47508 float64x1_t __ret;
47509 __ret = __builtin_shufflevector(__p0, __p0, 1);
4679347510 return __ret;
4679447511}
4679547512#else
46796__ai float16x8_t vzip1q_f16(float16x8_t __p0, float16x8_t __p1) {
46797 float16x8_t __ret;
46798 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
46799 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
46800 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 8, 1, 9, 2, 10, 3, 11);
46801 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
47513__ai float64x1_t vget_high_f64(float64x2_t __p0) {
47514 float64x1_t __ret;
47515 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
47516 __ret = __builtin_shufflevector(__rev0, __rev0, 1);
4680247517 return __ret;
4680347518}
4680447519#endif
4680547520
47521#define vget_lane_p64(__p0, __p1) __extension__ ({ \
47522 poly64_t __ret; \
47523 poly64x1_t __s0 = __p0; \
47524 __ret = (poly64_t) __builtin_neon_vget_lane_i64((poly64x1_t)__s0, __p1); \
47525 __ret; \
47526})
4680647527#ifdef __LITTLE_ENDIAN__
46807__ai float16x4_t vzip1_f16(float16x4_t __p0, float16x4_t __p1) {
46808 float16x4_t __ret;
46809 __ret = __builtin_shufflevector(__p0, __p1, 0, 4, 1, 5);
46810 return __ret;
46811}
47528#define vgetq_lane_p64(__p0, __p1) __extension__ ({ \
47529 poly64_t __ret; \
47530 poly64x2_t __s0 = __p0; \
47531 __ret = (poly64_t) __builtin_neon_vgetq_lane_i64((poly64x2_t)__s0, __p1); \
47532 __ret; \
47533})
4681247534#else
46813__ai float16x4_t vzip1_f16(float16x4_t __p0, float16x4_t __p1) {
46814 float16x4_t __ret;
46815 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
46816 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
46817 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 4, 1, 5);
46818 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
46819 return __ret;
46820}
47535#define vgetq_lane_p64(__p0, __p1) __extension__ ({ \
47536 poly64_t __ret; \
47537 poly64x2_t __s0 = __p0; \
47538 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
47539 __ret = (poly64_t) __builtin_neon_vgetq_lane_i64((poly64x2_t)__rev0, __p1); \
47540 __ret; \
47541})
47542#define __noswap_vgetq_lane_p64(__p0, __p1) __extension__ ({ \
47543 poly64_t __ret; \
47544 poly64x2_t __s0 = __p0; \
47545 __ret = (poly64_t) __builtin_neon_vgetq_lane_i64((poly64x2_t)__s0, __p1); \
47546 __ret; \
47547})
4682147548#endif
4682247549
4682347550#ifdef __LITTLE_ENDIAN__
46824__ai float16x8_t vzip2q_f16(float16x8_t __p0, float16x8_t __p1) {
46825 float16x8_t __ret;
46826 __ret = __builtin_shufflevector(__p0, __p1, 4, 12, 5, 13, 6, 14, 7, 15);
46827 return __ret;
46828}
47551#define vgetq_lane_f64(__p0, __p1) __extension__ ({ \
47552 float64_t __ret; \
47553 float64x2_t __s0 = __p0; \
47554 __ret = (float64_t) __builtin_neon_vgetq_lane_f64((float64x2_t)__s0, __p1); \
47555 __ret; \
47556})
4682947557#else
46830__ai float16x8_t vzip2q_f16(float16x8_t __p0, float16x8_t __p1) {
46831 float16x8_t __ret;
46832 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
46833 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
46834 __ret = __builtin_shufflevector(__rev0, __rev1, 4, 12, 5, 13, 6, 14, 7, 15);
46835 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
46836 return __ret;
46837}
47558#define vgetq_lane_f64(__p0, __p1) __extension__ ({ \
47559 float64_t __ret; \
47560 float64x2_t __s0 = __p0; \
47561 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
47562 __ret = (float64_t) __builtin_neon_vgetq_lane_f64((float64x2_t)__rev0, __p1); \
47563 __ret; \
47564})
47565#define __noswap_vgetq_lane_f64(__p0, __p1) __extension__ ({ \
47566 float64_t __ret; \
47567 float64x2_t __s0 = __p0; \
47568 __ret = (float64_t) __builtin_neon_vgetq_lane_f64((float64x2_t)__s0, __p1); \
47569 __ret; \
47570})
4683847571#endif
4683947572
47573#define vget_lane_f64(__p0, __p1) __extension__ ({ \
47574 float64_t __ret; \
47575 float64x1_t __s0 = __p0; \
47576 __ret = (float64_t) __builtin_neon_vget_lane_f64((float64x1_t)__s0, __p1); \
47577 __ret; \
47578})
4684047579#ifdef __LITTLE_ENDIAN__
46841__ai float16x4_t vzip2_f16(float16x4_t __p0, float16x4_t __p1) {
46842 float16x4_t __ret;
46843 __ret = __builtin_shufflevector(__p0, __p1, 2, 6, 3, 7);
47580__ai poly64x1_t vget_low_p64(poly64x2_t __p0) {
47581 poly64x1_t __ret;
47582 __ret = __builtin_shufflevector(__p0, __p0, 0);
4684447583 return __ret;
4684547584}
4684647585#else
46847__ai float16x4_t vzip2_f16(float16x4_t __p0, float16x4_t __p1) {
46848 float16x4_t __ret;
46849 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
46850 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
46851 __ret = __builtin_shufflevector(__rev0, __rev1, 2, 6, 3, 7);
46852 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
47586__ai poly64x1_t vget_low_p64(poly64x2_t __p0) {
47587 poly64x1_t __ret;
47588 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
47589 __ret = __builtin_shufflevector(__rev0, __rev0, 0);
4685347590 return __ret;
4685447591}
4685547592#endif
4685647593
46857#endif
46858#if defined(__ARM_FEATURE_MATMUL_INT8)
4685947594#ifdef __LITTLE_ENDIAN__
46860__ai uint32x4_t vmmlaq_u32(uint32x4_t __p0, uint8x16_t __p1, uint8x16_t __p2) {
46861 uint32x4_t __ret;
46862 __ret = (uint32x4_t) __builtin_neon_vmmlaq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 50);
47595__ai float64x1_t vget_low_f64(float64x2_t __p0) {
47596 float64x1_t __ret;
47597 __ret = __builtin_shufflevector(__p0, __p0, 0);
4686347598 return __ret;
4686447599}
4686547600#else
46866__ai uint32x4_t vmmlaq_u32(uint32x4_t __p0, uint8x16_t __p1, uint8x16_t __p2) {
46867 uint32x4_t __ret;
46868 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
46869 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
46870 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
46871 __ret = (uint32x4_t) __builtin_neon_vmmlaq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 50);
46872 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
47601__ai float64x1_t vget_low_f64(float64x2_t __p0) {
47602 float64x1_t __ret;
47603 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
47604 __ret = __builtin_shufflevector(__rev0, __rev0, 0);
4687347605 return __ret;
4687447606}
4687547607#endif
4687647608
47609#define vld1_p64(__p0) __extension__ ({ \
47610 poly64x1_t __ret; \
47611 __ret = (poly64x1_t) __builtin_neon_vld1_v(__p0, 6); \
47612 __ret; \
47613})
4687747614#ifdef __LITTLE_ENDIAN__
46878__ai int32x4_t vmmlaq_s32(int32x4_t __p0, int8x16_t __p1, int8x16_t __p2) {
46879 int32x4_t __ret;
46880 __ret = (int32x4_t) __builtin_neon_vmmlaq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 34);
46881 return __ret;
46882}
47615#define vld1q_p64(__p0) __extension__ ({ \
47616 poly64x2_t __ret; \
47617 __ret = (poly64x2_t) __builtin_neon_vld1q_v(__p0, 38); \
47618 __ret; \
47619})
4688347620#else
46884__ai int32x4_t vmmlaq_s32(int32x4_t __p0, int8x16_t __p1, int8x16_t __p2) {
46885 int32x4_t __ret;
46886 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
46887 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
46888 int8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
46889 __ret = (int32x4_t) __builtin_neon_vmmlaq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 34);
46890 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
46891 return __ret;
46892}
47621#define vld1q_p64(__p0) __extension__ ({ \
47622 poly64x2_t __ret; \
47623 __ret = (poly64x2_t) __builtin_neon_vld1q_v(__p0, 38); \
47624 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
47625 __ret; \
47626})
4689347627#endif
4689447628
4689547629#ifdef __LITTLE_ENDIAN__
46896__ai int32x4_t vusdotq_s32(int32x4_t __p0, uint8x16_t __p1, int8x16_t __p2) {
46897 int32x4_t __ret;
46898 __ret = (int32x4_t) __builtin_neon_vusdotq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 34);
46899 return __ret;
46900}
47630#define vld1q_f64(__p0) __extension__ ({ \
47631 float64x2_t __ret; \
47632 __ret = (float64x2_t) __builtin_neon_vld1q_v(__p0, 42); \
47633 __ret; \
47634})
4690147635#else
46902__ai int32x4_t vusdotq_s32(int32x4_t __p0, uint8x16_t __p1, int8x16_t __p2) {
46903 int32x4_t __ret;
46904 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
46905 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
46906 int8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
46907 __ret = (int32x4_t) __builtin_neon_vusdotq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 34);
46908 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
46909 return __ret;
46910}
46911__ai int32x4_t __noswap_vusdotq_s32(int32x4_t __p0, uint8x16_t __p1, int8x16_t __p2) {
46912 int32x4_t __ret;
46913 __ret = (int32x4_t) __builtin_neon_vusdotq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 34);
46914 return __ret;
46915}
47636#define vld1q_f64(__p0) __extension__ ({ \
47637 float64x2_t __ret; \
47638 __ret = (float64x2_t) __builtin_neon_vld1q_v(__p0, 42); \
47639 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
47640 __ret; \
47641})
4691647642#endif
4691747643
47644#define vld1_f64(__p0) __extension__ ({ \
47645 float64x1_t __ret; \
47646 __ret = (float64x1_t) __builtin_neon_vld1_v(__p0, 10); \
47647 __ret; \
47648})
47649#define vld1_dup_p64(__p0) __extension__ ({ \
47650 poly64x1_t __ret; \
47651 __ret = (poly64x1_t) __builtin_neon_vld1_dup_v(__p0, 6); \
47652 __ret; \
47653})
4691847654#ifdef __LITTLE_ENDIAN__
46919__ai int32x2_t vusdot_s32(int32x2_t __p0, uint8x8_t __p1, int8x8_t __p2) {
46920 int32x2_t __ret;
46921 __ret = (int32x2_t) __builtin_neon_vusdot_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 2);
46922 return __ret;
46923}
47655#define vld1q_dup_p64(__p0) __extension__ ({ \
47656 poly64x2_t __ret; \
47657 __ret = (poly64x2_t) __builtin_neon_vld1q_dup_v(__p0, 38); \
47658 __ret; \
47659})
4692447660#else
46925__ai int32x2_t vusdot_s32(int32x2_t __p0, uint8x8_t __p1, int8x8_t __p2) {
46926 int32x2_t __ret;
46927 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
46928 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
46929 int8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
46930 __ret = (int32x2_t) __builtin_neon_vusdot_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 2);
46931 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
46932 return __ret;
46933}
46934__ai int32x2_t __noswap_vusdot_s32(int32x2_t __p0, uint8x8_t __p1, int8x8_t __p2) {
46935 int32x2_t __ret;
46936 __ret = (int32x2_t) __builtin_neon_vusdot_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 2);
46937 return __ret;
46938}
47661#define vld1q_dup_p64(__p0) __extension__ ({ \
47662 poly64x2_t __ret; \
47663 __ret = (poly64x2_t) __builtin_neon_vld1q_dup_v(__p0, 38); \
47664 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
47665 __ret; \
47666})
4693947667#endif
4694047668
4694147669#ifdef __LITTLE_ENDIAN__
46942#define vusdotq_lane_s32(__p0_305, __p1_305, __p2_305, __p3_305) __extension__ ({ \
46943 int32x4_t __ret_305; \
46944 int32x4_t __s0_305 = __p0_305; \
46945 uint8x16_t __s1_305 = __p1_305; \
46946 int8x8_t __s2_305 = __p2_305; \
46947int8x8_t __reint_305 = __s2_305; \
46948 __ret_305 = vusdotq_s32(__s0_305, __s1_305, (int8x16_t)(splatq_lane_s32(*(int32x2_t *) &__reint_305, __p3_305))); \
46949 __ret_305; \
47670#define vld1q_dup_f64(__p0) __extension__ ({ \
47671 float64x2_t __ret; \
47672 __ret = (float64x2_t) __builtin_neon_vld1q_dup_v(__p0, 42); \
47673 __ret; \
4695047674})
4695147675#else
46952#define vusdotq_lane_s32(__p0_306, __p1_306, __p2_306, __p3_306) __extension__ ({ \
46953 int32x4_t __ret_306; \
46954 int32x4_t __s0_306 = __p0_306; \
46955 uint8x16_t __s1_306 = __p1_306; \
46956 int8x8_t __s2_306 = __p2_306; \
46957 int32x4_t __rev0_306; __rev0_306 = __builtin_shufflevector(__s0_306, __s0_306, 3, 2, 1, 0); \
46958 uint8x16_t __rev1_306; __rev1_306 = __builtin_shufflevector(__s1_306, __s1_306, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
46959 int8x8_t __rev2_306; __rev2_306 = __builtin_shufflevector(__s2_306, __s2_306, 7, 6, 5, 4, 3, 2, 1, 0); \
46960int8x8_t __reint_306 = __rev2_306; \
46961 __ret_306 = __noswap_vusdotq_s32(__rev0_306, __rev1_306, (int8x16_t)(__noswap_splatq_lane_s32(*(int32x2_t *) &__reint_306, __p3_306))); \
46962 __ret_306 = __builtin_shufflevector(__ret_306, __ret_306, 3, 2, 1, 0); \
46963 __ret_306; \
47676#define vld1q_dup_f64(__p0) __extension__ ({ \
47677 float64x2_t __ret; \
47678 __ret = (float64x2_t) __builtin_neon_vld1q_dup_v(__p0, 42); \
47679 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
47680 __ret; \
4696447681})
4696547682#endif
4696647683
47684#define vld1_dup_f64(__p0) __extension__ ({ \
47685 float64x1_t __ret; \
47686 __ret = (float64x1_t) __builtin_neon_vld1_dup_v(__p0, 10); \
47687 __ret; \
47688})
47689#define vld1_lane_p64(__p0, __p1, __p2) __extension__ ({ \
47690 poly64x1_t __ret; \
47691 poly64x1_t __s1 = __p1; \
47692 __ret = (poly64x1_t) __builtin_neon_vld1_lane_v(__p0, (int8x8_t)__s1, __p2, 6); \
47693 __ret; \
47694})
4696747695#ifdef __LITTLE_ENDIAN__
46968#define vusdot_lane_s32(__p0_307, __p1_307, __p2_307, __p3_307) __extension__ ({ \
46969 int32x2_t __ret_307; \
46970 int32x2_t __s0_307 = __p0_307; \
46971 uint8x8_t __s1_307 = __p1_307; \
46972 int8x8_t __s2_307 = __p2_307; \
46973int8x8_t __reint_307 = __s2_307; \
46974 __ret_307 = vusdot_s32(__s0_307, __s1_307, (int8x8_t)(splat_lane_s32(*(int32x2_t *) &__reint_307, __p3_307))); \
46975 __ret_307; \
47696#define vld1q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
47697 poly64x2_t __ret; \
47698 poly64x2_t __s1 = __p1; \
47699 __ret = (poly64x2_t) __builtin_neon_vld1q_lane_v(__p0, (int8x16_t)__s1, __p2, 38); \
47700 __ret; \
4697647701})
4697747702#else
46978#define vusdot_lane_s32(__p0_308, __p1_308, __p2_308, __p3_308) __extension__ ({ \
46979 int32x2_t __ret_308; \
46980 int32x2_t __s0_308 = __p0_308; \
46981 uint8x8_t __s1_308 = __p1_308; \
46982 int8x8_t __s2_308 = __p2_308; \
46983 int32x2_t __rev0_308; __rev0_308 = __builtin_shufflevector(__s0_308, __s0_308, 1, 0); \
46984 uint8x8_t __rev1_308; __rev1_308 = __builtin_shufflevector(__s1_308, __s1_308, 7, 6, 5, 4, 3, 2, 1, 0); \
46985 int8x8_t __rev2_308; __rev2_308 = __builtin_shufflevector(__s2_308, __s2_308, 7, 6, 5, 4, 3, 2, 1, 0); \
46986int8x8_t __reint_308 = __rev2_308; \
46987 __ret_308 = __noswap_vusdot_s32(__rev0_308, __rev1_308, (int8x8_t)(__noswap_splat_lane_s32(*(int32x2_t *) &__reint_308, __p3_308))); \
46988 __ret_308 = __builtin_shufflevector(__ret_308, __ret_308, 1, 0); \
46989 __ret_308; \
47703#define vld1q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
47704 poly64x2_t __ret; \
47705 poly64x2_t __s1 = __p1; \
47706 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
47707 __ret = (poly64x2_t) __builtin_neon_vld1q_lane_v(__p0, (int8x16_t)__rev1, __p2, 38); \
47708 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
47709 __ret; \
4699047710})
4699147711#endif
4699247712
4699347713#ifdef __LITTLE_ENDIAN__
46994__ai int32x4_t vusmmlaq_s32(int32x4_t __p0, uint8x16_t __p1, int8x16_t __p2) {
46995 int32x4_t __ret;
46996 __ret = (int32x4_t) __builtin_neon_vusmmlaq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 34);
46997 return __ret;
46998}
47714#define vld1q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
47715 float64x2_t __ret; \
47716 float64x2_t __s1 = __p1; \
47717 __ret = (float64x2_t) __builtin_neon_vld1q_lane_v(__p0, (int8x16_t)__s1, __p2, 42); \
47718 __ret; \
47719})
4699947720#else
47000__ai int32x4_t vusmmlaq_s32(int32x4_t __p0, uint8x16_t __p1, int8x16_t __p2) {
47001 int32x4_t __ret;
47002 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
47003 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
47004 int8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
47005 __ret = (int32x4_t) __builtin_neon_vusmmlaq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 34);
47006 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
47007 return __ret;
47008}
47721#define vld1q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
47722 float64x2_t __ret; \
47723 float64x2_t __s1 = __p1; \
47724 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
47725 __ret = (float64x2_t) __builtin_neon_vld1q_lane_v(__p0, (int8x16_t)__rev1, __p2, 42); \
47726 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
47727 __ret; \
47728})
4700947729#endif
4701047730
47011#endif
47012#if defined(__ARM_FEATURE_QRDMX)
47731#define vld1_lane_f64(__p0, __p1, __p2) __extension__ ({ \
47732 float64x1_t __ret; \
47733 float64x1_t __s1 = __p1; \
47734 __ret = (float64x1_t) __builtin_neon_vld1_lane_v(__p0, (int8x8_t)__s1, __p2, 10); \
47735 __ret; \
47736})
47737#define vld1_p64_x2(__p0) __extension__ ({ \
47738 poly64x1x2_t __ret; \
47739 __builtin_neon_vld1_x2_v(&__ret, __p0, 6); \
47740 __ret; \
47741})
4701347742#ifdef __LITTLE_ENDIAN__
47014__ai int32x4_t vqrdmlahq_s32(int32x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
47015 int32x4_t __ret;
47016 __ret = (int32x4_t) __builtin_neon_vqrdmlahq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 34);
47017 return __ret;
47018}
47743#define vld1q_p64_x2(__p0) __extension__ ({ \
47744 poly64x2x2_t __ret; \
47745 __builtin_neon_vld1q_x2_v(&__ret, __p0, 38); \
47746 __ret; \
47747})
4701947748#else
47020__ai int32x4_t vqrdmlahq_s32(int32x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
47021 int32x4_t __ret;
47022 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
47023 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
47024 int32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
47025 __ret = (int32x4_t) __builtin_neon_vqrdmlahq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 34);
47026 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
47027 return __ret;
47028}
47029__ai int32x4_t __noswap_vqrdmlahq_s32(int32x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
47030 int32x4_t __ret;
47031 __ret = (int32x4_t) __builtin_neon_vqrdmlahq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 34);
47032 return __ret;
47033}
47749#define vld1q_p64_x2(__p0) __extension__ ({ \
47750 poly64x2x2_t __ret; \
47751 __builtin_neon_vld1q_x2_v(&__ret, __p0, 38); \
47752 \
47753 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
47754 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
47755 __ret; \
47756})
4703447757#endif
4703547758
4703647759#ifdef __LITTLE_ENDIAN__
47037__ai int16x8_t vqrdmlahq_s16(int16x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
47038 int16x8_t __ret;
47039 __ret = (int16x8_t) __builtin_neon_vqrdmlahq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 33);
47040 return __ret;
47041}
47760#define vld1q_f64_x2(__p0) __extension__ ({ \
47761 float64x2x2_t __ret; \
47762 __builtin_neon_vld1q_x2_v(&__ret, __p0, 42); \
47763 __ret; \
47764})
4704247765#else
47043__ai int16x8_t vqrdmlahq_s16(int16x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
47044 int16x8_t __ret;
47045 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
47046 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
47047 int16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
47048 __ret = (int16x8_t) __builtin_neon_vqrdmlahq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 33);
47049 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
47050 return __ret;
47051}
47052__ai int16x8_t __noswap_vqrdmlahq_s16(int16x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
47053 int16x8_t __ret;
47054 __ret = (int16x8_t) __builtin_neon_vqrdmlahq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 33);
47055 return __ret;
47056}
47766#define vld1q_f64_x2(__p0) __extension__ ({ \
47767 float64x2x2_t __ret; \
47768 __builtin_neon_vld1q_x2_v(&__ret, __p0, 42); \
47769 \
47770 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
47771 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
47772 __ret; \
47773})
4705747774#endif
4705847775
47776#define vld1_f64_x2(__p0) __extension__ ({ \
47777 float64x1x2_t __ret; \
47778 __builtin_neon_vld1_x2_v(&__ret, __p0, 10); \
47779 __ret; \
47780})
47781#define vld1_p64_x3(__p0) __extension__ ({ \
47782 poly64x1x3_t __ret; \
47783 __builtin_neon_vld1_x3_v(&__ret, __p0, 6); \
47784 __ret; \
47785})
4705947786#ifdef __LITTLE_ENDIAN__
47060__ai int32x2_t vqrdmlah_s32(int32x2_t __p0, int32x2_t __p1, int32x2_t __p2) {
47061 int32x2_t __ret;
47062 __ret = (int32x2_t) __builtin_neon_vqrdmlah_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 2);
47063 return __ret;
47064}
47787#define vld1q_p64_x3(__p0) __extension__ ({ \
47788 poly64x2x3_t __ret; \
47789 __builtin_neon_vld1q_x3_v(&__ret, __p0, 38); \
47790 __ret; \
47791})
4706547792#else
47066__ai int32x2_t vqrdmlah_s32(int32x2_t __p0, int32x2_t __p1, int32x2_t __p2) {
47067 int32x2_t __ret;
47068 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
47069 int32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
47070 int32x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
47071 __ret = (int32x2_t) __builtin_neon_vqrdmlah_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 2);
47072 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
47073 return __ret;
47074}
47075__ai int32x2_t __noswap_vqrdmlah_s32(int32x2_t __p0, int32x2_t __p1, int32x2_t __p2) {
47076 int32x2_t __ret;
47077 __ret = (int32x2_t) __builtin_neon_vqrdmlah_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 2);
47078 return __ret;
47079}
47793#define vld1q_p64_x3(__p0) __extension__ ({ \
47794 poly64x2x3_t __ret; \
47795 __builtin_neon_vld1q_x3_v(&__ret, __p0, 38); \
47796 \
47797 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
47798 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
47799 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
47800 __ret; \
47801})
4708047802#endif
4708147803
4708247804#ifdef __LITTLE_ENDIAN__
47083__ai int16x4_t vqrdmlah_s16(int16x4_t __p0, int16x4_t __p1, int16x4_t __p2) {
47084 int16x4_t __ret;
47085 __ret = (int16x4_t) __builtin_neon_vqrdmlah_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 1);
47086 return __ret;
47087}
47805#define vld1q_f64_x3(__p0) __extension__ ({ \
47806 float64x2x3_t __ret; \
47807 __builtin_neon_vld1q_x3_v(&__ret, __p0, 42); \
47808 __ret; \
47809})
4708847810#else
47089__ai int16x4_t vqrdmlah_s16(int16x4_t __p0, int16x4_t __p1, int16x4_t __p2) {
47090 int16x4_t __ret;
47091 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
47092 int16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
47093 int16x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
47094 __ret = (int16x4_t) __builtin_neon_vqrdmlah_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 1);
47095 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
47096 return __ret;
47097}
47098__ai int16x4_t __noswap_vqrdmlah_s16(int16x4_t __p0, int16x4_t __p1, int16x4_t __p2) {
47099 int16x4_t __ret;
47100 __ret = (int16x4_t) __builtin_neon_vqrdmlah_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 1);
47101 return __ret;
47102}
47811#define vld1q_f64_x3(__p0) __extension__ ({ \
47812 float64x2x3_t __ret; \
47813 __builtin_neon_vld1q_x3_v(&__ret, __p0, 42); \
47814 \
47815 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
47816 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
47817 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
47818 __ret; \
47819})
4710347820#endif
4710447821
47822#define vld1_f64_x3(__p0) __extension__ ({ \
47823 float64x1x3_t __ret; \
47824 __builtin_neon_vld1_x3_v(&__ret, __p0, 10); \
47825 __ret; \
47826})
47827#define vld1_p64_x4(__p0) __extension__ ({ \
47828 poly64x1x4_t __ret; \
47829 __builtin_neon_vld1_x4_v(&__ret, __p0, 6); \
47830 __ret; \
47831})
4710547832#ifdef __LITTLE_ENDIAN__
47106#define vqrdmlahq_lane_s32(__p0_309, __p1_309, __p2_309, __p3_309) __extension__ ({ \
47107 int32x4_t __ret_309; \
47108 int32x4_t __s0_309 = __p0_309; \
47109 int32x4_t __s1_309 = __p1_309; \
47110 int32x2_t __s2_309 = __p2_309; \
47111 __ret_309 = vqrdmlahq_s32(__s0_309, __s1_309, splatq_lane_s32(__s2_309, __p3_309)); \
47112 __ret_309; \
47833#define vld1q_p64_x4(__p0) __extension__ ({ \
47834 poly64x2x4_t __ret; \
47835 __builtin_neon_vld1q_x4_v(&__ret, __p0, 38); \
47836 __ret; \
4711347837})
4711447838#else
47115#define vqrdmlahq_lane_s32(__p0_310, __p1_310, __p2_310, __p3_310) __extension__ ({ \
47116 int32x4_t __ret_310; \
47117 int32x4_t __s0_310 = __p0_310; \
47118 int32x4_t __s1_310 = __p1_310; \
47119 int32x2_t __s2_310 = __p2_310; \
47120 int32x4_t __rev0_310; __rev0_310 = __builtin_shufflevector(__s0_310, __s0_310, 3, 2, 1, 0); \
47121 int32x4_t __rev1_310; __rev1_310 = __builtin_shufflevector(__s1_310, __s1_310, 3, 2, 1, 0); \
47122 int32x2_t __rev2_310; __rev2_310 = __builtin_shufflevector(__s2_310, __s2_310, 1, 0); \
47123 __ret_310 = __noswap_vqrdmlahq_s32(__rev0_310, __rev1_310, __noswap_splatq_lane_s32(__rev2_310, __p3_310)); \
47124 __ret_310 = __builtin_shufflevector(__ret_310, __ret_310, 3, 2, 1, 0); \
47125 __ret_310; \
47839#define vld1q_p64_x4(__p0) __extension__ ({ \
47840 poly64x2x4_t __ret; \
47841 __builtin_neon_vld1q_x4_v(&__ret, __p0, 38); \
47842 \
47843 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
47844 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
47845 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
47846 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 1, 0); \
47847 __ret; \
4712647848})
4712747849#endif
4712847850
4712947851#ifdef __LITTLE_ENDIAN__
47130#define vqrdmlahq_lane_s16(__p0_311, __p1_311, __p2_311, __p3_311) __extension__ ({ \
47131 int16x8_t __ret_311; \
47132 int16x8_t __s0_311 = __p0_311; \
47133 int16x8_t __s1_311 = __p1_311; \
47134 int16x4_t __s2_311 = __p2_311; \
47135 __ret_311 = vqrdmlahq_s16(__s0_311, __s1_311, splatq_lane_s16(__s2_311, __p3_311)); \
47136 __ret_311; \
47852#define vld1q_f64_x4(__p0) __extension__ ({ \
47853 float64x2x4_t __ret; \
47854 __builtin_neon_vld1q_x4_v(&__ret, __p0, 42); \
47855 __ret; \
4713747856})
4713847857#else
47139#define vqrdmlahq_lane_s16(__p0_312, __p1_312, __p2_312, __p3_312) __extension__ ({ \
47140 int16x8_t __ret_312; \
47141 int16x8_t __s0_312 = __p0_312; \
47142 int16x8_t __s1_312 = __p1_312; \
47143 int16x4_t __s2_312 = __p2_312; \
47144 int16x8_t __rev0_312; __rev0_312 = __builtin_shufflevector(__s0_312, __s0_312, 7, 6, 5, 4, 3, 2, 1, 0); \
47145 int16x8_t __rev1_312; __rev1_312 = __builtin_shufflevector(__s1_312, __s1_312, 7, 6, 5, 4, 3, 2, 1, 0); \
47146 int16x4_t __rev2_312; __rev2_312 = __builtin_shufflevector(__s2_312, __s2_312, 3, 2, 1, 0); \
47147 __ret_312 = __noswap_vqrdmlahq_s16(__rev0_312, __rev1_312, __noswap_splatq_lane_s16(__rev2_312, __p3_312)); \
47148 __ret_312 = __builtin_shufflevector(__ret_312, __ret_312, 7, 6, 5, 4, 3, 2, 1, 0); \
47149 __ret_312; \
47858#define vld1q_f64_x4(__p0) __extension__ ({ \
47859 float64x2x4_t __ret; \
47860 __builtin_neon_vld1q_x4_v(&__ret, __p0, 42); \
47861 \
47862 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
47863 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
47864 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
47865 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 1, 0); \
47866 __ret; \
4715047867})
4715147868#endif
4715247869
47870#define vld1_f64_x4(__p0) __extension__ ({ \
47871 float64x1x4_t __ret; \
47872 __builtin_neon_vld1_x4_v(&__ret, __p0, 10); \
47873 __ret; \
47874})
47875#define vld2_p64(__p0) __extension__ ({ \
47876 poly64x1x2_t __ret; \
47877 __builtin_neon_vld2_v(&__ret, __p0, 6); \
47878 __ret; \
47879})
4715347880#ifdef __LITTLE_ENDIAN__
47154#define vqrdmlah_lane_s32(__p0_313, __p1_313, __p2_313, __p3_313) __extension__ ({ \
47155 int32x2_t __ret_313; \
47156 int32x2_t __s0_313 = __p0_313; \
47157 int32x2_t __s1_313 = __p1_313; \
47158 int32x2_t __s2_313 = __p2_313; \
47159 __ret_313 = vqrdmlah_s32(__s0_313, __s1_313, splat_lane_s32(__s2_313, __p3_313)); \
47160 __ret_313; \
47881#define vld2q_p64(__p0) __extension__ ({ \
47882 poly64x2x2_t __ret; \
47883 __builtin_neon_vld2q_v(&__ret, __p0, 38); \
47884 __ret; \
4716147885})
4716247886#else
47163#define vqrdmlah_lane_s32(__p0_314, __p1_314, __p2_314, __p3_314) __extension__ ({ \
47164 int32x2_t __ret_314; \
47165 int32x2_t __s0_314 = __p0_314; \
47166 int32x2_t __s1_314 = __p1_314; \
47167 int32x2_t __s2_314 = __p2_314; \
47168 int32x2_t __rev0_314; __rev0_314 = __builtin_shufflevector(__s0_314, __s0_314, 1, 0); \
47169 int32x2_t __rev1_314; __rev1_314 = __builtin_shufflevector(__s1_314, __s1_314, 1, 0); \
47170 int32x2_t __rev2_314; __rev2_314 = __builtin_shufflevector(__s2_314, __s2_314, 1, 0); \
47171 __ret_314 = __noswap_vqrdmlah_s32(__rev0_314, __rev1_314, __noswap_splat_lane_s32(__rev2_314, __p3_314)); \
47172 __ret_314 = __builtin_shufflevector(__ret_314, __ret_314, 1, 0); \
47173 __ret_314; \
47887#define vld2q_p64(__p0) __extension__ ({ \
47888 poly64x2x2_t __ret; \
47889 __builtin_neon_vld2q_v(&__ret, __p0, 38); \
47890 \
47891 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
47892 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
47893 __ret; \
4717447894})
4717547895#endif
4717647896
4717747897#ifdef __LITTLE_ENDIAN__
47178#define vqrdmlah_lane_s16(__p0_315, __p1_315, __p2_315, __p3_315) __extension__ ({ \
47179 int16x4_t __ret_315; \
47180 int16x4_t __s0_315 = __p0_315; \
47181 int16x4_t __s1_315 = __p1_315; \
47182 int16x4_t __s2_315 = __p2_315; \
47183 __ret_315 = vqrdmlah_s16(__s0_315, __s1_315, splat_lane_s16(__s2_315, __p3_315)); \
47184 __ret_315; \
47898#define vld2q_u64(__p0) __extension__ ({ \
47899 uint64x2x2_t __ret; \
47900 __builtin_neon_vld2q_v(&__ret, __p0, 51); \
47901 __ret; \
4718547902})
4718647903#else
47187#define vqrdmlah_lane_s16(__p0_316, __p1_316, __p2_316, __p3_316) __extension__ ({ \
47188 int16x4_t __ret_316; \
47189 int16x4_t __s0_316 = __p0_316; \
47190 int16x4_t __s1_316 = __p1_316; \
47191 int16x4_t __s2_316 = __p2_316; \
47192 int16x4_t __rev0_316; __rev0_316 = __builtin_shufflevector(__s0_316, __s0_316, 3, 2, 1, 0); \
47193 int16x4_t __rev1_316; __rev1_316 = __builtin_shufflevector(__s1_316, __s1_316, 3, 2, 1, 0); \
47194 int16x4_t __rev2_316; __rev2_316 = __builtin_shufflevector(__s2_316, __s2_316, 3, 2, 1, 0); \
47195 __ret_316 = __noswap_vqrdmlah_s16(__rev0_316, __rev1_316, __noswap_splat_lane_s16(__rev2_316, __p3_316)); \
47196 __ret_316 = __builtin_shufflevector(__ret_316, __ret_316, 3, 2, 1, 0); \
47197 __ret_316; \
47904#define vld2q_u64(__p0) __extension__ ({ \
47905 uint64x2x2_t __ret; \
47906 __builtin_neon_vld2q_v(&__ret, __p0, 51); \
47907 \
47908 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
47909 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
47910 __ret; \
4719847911})
4719947912#endif
4720047913
4720147914#ifdef __LITTLE_ENDIAN__
47202__ai int32x4_t vqrdmlshq_s32(int32x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
47203 int32x4_t __ret;
47204 __ret = (int32x4_t) __builtin_neon_vqrdmlshq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 34);
47205 return __ret;
47206}
47915#define vld2q_f64(__p0) __extension__ ({ \
47916 float64x2x2_t __ret; \
47917 __builtin_neon_vld2q_v(&__ret, __p0, 42); \
47918 __ret; \
47919})
4720747920#else
47208__ai int32x4_t vqrdmlshq_s32(int32x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
47209 int32x4_t __ret;
47210 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
47211 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
47212 int32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
47213 __ret = (int32x4_t) __builtin_neon_vqrdmlshq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 34);
47214 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
47215 return __ret;
47216}
47217__ai int32x4_t __noswap_vqrdmlshq_s32(int32x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
47218 int32x4_t __ret;
47219 __ret = (int32x4_t) __builtin_neon_vqrdmlshq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 34);
47220 return __ret;
47221}
47921#define vld2q_f64(__p0) __extension__ ({ \
47922 float64x2x2_t __ret; \
47923 __builtin_neon_vld2q_v(&__ret, __p0, 42); \
47924 \
47925 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
47926 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
47927 __ret; \
47928})
4722247929#endif
4722347930
4722447931#ifdef __LITTLE_ENDIAN__
47225__ai int16x8_t vqrdmlshq_s16(int16x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
47226 int16x8_t __ret;
47227 __ret = (int16x8_t) __builtin_neon_vqrdmlshq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 33);
47228 return __ret;
47229}
47932#define vld2q_s64(__p0) __extension__ ({ \
47933 int64x2x2_t __ret; \
47934 __builtin_neon_vld2q_v(&__ret, __p0, 35); \
47935 __ret; \
47936})
4723047937#else
47231__ai int16x8_t vqrdmlshq_s16(int16x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
47232 int16x8_t __ret;
47233 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
47234 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
47235 int16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
47236 __ret = (int16x8_t) __builtin_neon_vqrdmlshq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 33);
47237 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
47238 return __ret;
47239}
47240__ai int16x8_t __noswap_vqrdmlshq_s16(int16x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
47241 int16x8_t __ret;
47242 __ret = (int16x8_t) __builtin_neon_vqrdmlshq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 33);
47243 return __ret;
47244}
47938#define vld2q_s64(__p0) __extension__ ({ \
47939 int64x2x2_t __ret; \
47940 __builtin_neon_vld2q_v(&__ret, __p0, 35); \
47941 \
47942 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
47943 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
47944 __ret; \
47945})
4724547946#endif
4724647947
47948#define vld2_f64(__p0) __extension__ ({ \
47949 float64x1x2_t __ret; \
47950 __builtin_neon_vld2_v(&__ret, __p0, 10); \
47951 __ret; \
47952})
47953#define vld2_dup_p64(__p0) __extension__ ({ \
47954 poly64x1x2_t __ret; \
47955 __builtin_neon_vld2_dup_v(&__ret, __p0, 6); \
47956 __ret; \
47957})
4724747958#ifdef __LITTLE_ENDIAN__
47248__ai int32x2_t vqrdmlsh_s32(int32x2_t __p0, int32x2_t __p1, int32x2_t __p2) {
47249 int32x2_t __ret;
47250 __ret = (int32x2_t) __builtin_neon_vqrdmlsh_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 2);
47251 return __ret;
47252}
47959#define vld2q_dup_p64(__p0) __extension__ ({ \
47960 poly64x2x2_t __ret; \
47961 __builtin_neon_vld2q_dup_v(&__ret, __p0, 38); \
47962 __ret; \
47963})
4725347964#else
47254__ai int32x2_t vqrdmlsh_s32(int32x2_t __p0, int32x2_t __p1, int32x2_t __p2) {
47255 int32x2_t __ret;
47256 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
47257 int32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
47258 int32x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
47259 __ret = (int32x2_t) __builtin_neon_vqrdmlsh_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 2);
47260 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
47261 return __ret;
47262}
47263__ai int32x2_t __noswap_vqrdmlsh_s32(int32x2_t __p0, int32x2_t __p1, int32x2_t __p2) {
47264 int32x2_t __ret;
47265 __ret = (int32x2_t) __builtin_neon_vqrdmlsh_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 2);
47266 return __ret;
47267}
47965#define vld2q_dup_p64(__p0) __extension__ ({ \
47966 poly64x2x2_t __ret; \
47967 __builtin_neon_vld2q_dup_v(&__ret, __p0, 38); \
47968 \
47969 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
47970 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
47971 __ret; \
47972})
4726847973#endif
4726947974
4727047975#ifdef __LITTLE_ENDIAN__
47271__ai int16x4_t vqrdmlsh_s16(int16x4_t __p0, int16x4_t __p1, int16x4_t __p2) {
47272 int16x4_t __ret;
47273 __ret = (int16x4_t) __builtin_neon_vqrdmlsh_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 1);
47274 return __ret;
47275}
47976#define vld2q_dup_f64(__p0) __extension__ ({ \
47977 float64x2x2_t __ret; \
47978 __builtin_neon_vld2q_dup_v(&__ret, __p0, 42); \
47979 __ret; \
47980})
4727647981#else
47277__ai int16x4_t vqrdmlsh_s16(int16x4_t __p0, int16x4_t __p1, int16x4_t __p2) {
47278 int16x4_t __ret;
47279 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
47280 int16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
47281 int16x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
47282 __ret = (int16x4_t) __builtin_neon_vqrdmlsh_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 1);
47283 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
47284 return __ret;
47285}
47286__ai int16x4_t __noswap_vqrdmlsh_s16(int16x4_t __p0, int16x4_t __p1, int16x4_t __p2) {
47287 int16x4_t __ret;
47288 __ret = (int16x4_t) __builtin_neon_vqrdmlsh_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 1);
47289 return __ret;
47290}
47982#define vld2q_dup_f64(__p0) __extension__ ({ \
47983 float64x2x2_t __ret; \
47984 __builtin_neon_vld2q_dup_v(&__ret, __p0, 42); \
47985 \
47986 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
47987 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
47988 __ret; \
47989})
4729147990#endif
4729247991
47992#define vld2_dup_f64(__p0) __extension__ ({ \
47993 float64x1x2_t __ret; \
47994 __builtin_neon_vld2_dup_v(&__ret, __p0, 10); \
47995 __ret; \
47996})
47997#define vld2_lane_p64(__p0, __p1, __p2) __extension__ ({ \
47998 poly64x1x2_t __ret; \
47999 poly64x1x2_t __s1 = __p1; \
48000 __builtin_neon_vld2_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], __p2, 6); \
48001 __ret; \
48002})
4729348003#ifdef __LITTLE_ENDIAN__
47294#define vqrdmlshq_lane_s32(__p0_317, __p1_317, __p2_317, __p3_317) __extension__ ({ \
47295 int32x4_t __ret_317; \
47296 int32x4_t __s0_317 = __p0_317; \
47297 int32x4_t __s1_317 = __p1_317; \
47298 int32x2_t __s2_317 = __p2_317; \
47299 __ret_317 = vqrdmlshq_s32(__s0_317, __s1_317, splatq_lane_s32(__s2_317, __p3_317)); \
47300 __ret_317; \
48004#define vld2q_lane_p8(__p0, __p1, __p2) __extension__ ({ \
48005 poly8x16x2_t __ret; \
48006 poly8x16x2_t __s1 = __p1; \
48007 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 36); \
48008 __ret; \
4730148009})
4730248010#else
47303#define vqrdmlshq_lane_s32(__p0_318, __p1_318, __p2_318, __p3_318) __extension__ ({ \
47304 int32x4_t __ret_318; \
47305 int32x4_t __s0_318 = __p0_318; \
47306 int32x4_t __s1_318 = __p1_318; \
47307 int32x2_t __s2_318 = __p2_318; \
47308 int32x4_t __rev0_318; __rev0_318 = __builtin_shufflevector(__s0_318, __s0_318, 3, 2, 1, 0); \
47309 int32x4_t __rev1_318; __rev1_318 = __builtin_shufflevector(__s1_318, __s1_318, 3, 2, 1, 0); \
47310 int32x2_t __rev2_318; __rev2_318 = __builtin_shufflevector(__s2_318, __s2_318, 1, 0); \
47311 __ret_318 = __noswap_vqrdmlshq_s32(__rev0_318, __rev1_318, __noswap_splatq_lane_s32(__rev2_318, __p3_318)); \
47312 __ret_318 = __builtin_shufflevector(__ret_318, __ret_318, 3, 2, 1, 0); \
47313 __ret_318; \
48011#define vld2q_lane_p8(__p0, __p1, __p2) __extension__ ({ \
48012 poly8x16x2_t __ret; \
48013 poly8x16x2_t __s1 = __p1; \
48014 poly8x16x2_t __rev1; \
48015 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48016 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48017 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 36); \
48018 \
48019 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48020 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48021 __ret; \
4731448022})
4731548023#endif
4731648024
4731748025#ifdef __LITTLE_ENDIAN__
47318#define vqrdmlshq_lane_s16(__p0_319, __p1_319, __p2_319, __p3_319) __extension__ ({ \
47319 int16x8_t __ret_319; \
47320 int16x8_t __s0_319 = __p0_319; \
47321 int16x8_t __s1_319 = __p1_319; \
47322 int16x4_t __s2_319 = __p2_319; \
47323 __ret_319 = vqrdmlshq_s16(__s0_319, __s1_319, splatq_lane_s16(__s2_319, __p3_319)); \
47324 __ret_319; \
48026#define vld2q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
48027 poly64x2x2_t __ret; \
48028 poly64x2x2_t __s1 = __p1; \
48029 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 38); \
48030 __ret; \
4732548031})
4732648032#else
47327#define vqrdmlshq_lane_s16(__p0_320, __p1_320, __p2_320, __p3_320) __extension__ ({ \
47328 int16x8_t __ret_320; \
47329 int16x8_t __s0_320 = __p0_320; \
47330 int16x8_t __s1_320 = __p1_320; \
47331 int16x4_t __s2_320 = __p2_320; \
47332 int16x8_t __rev0_320; __rev0_320 = __builtin_shufflevector(__s0_320, __s0_320, 7, 6, 5, 4, 3, 2, 1, 0); \
47333 int16x8_t __rev1_320; __rev1_320 = __builtin_shufflevector(__s1_320, __s1_320, 7, 6, 5, 4, 3, 2, 1, 0); \
47334 int16x4_t __rev2_320; __rev2_320 = __builtin_shufflevector(__s2_320, __s2_320, 3, 2, 1, 0); \
47335 __ret_320 = __noswap_vqrdmlshq_s16(__rev0_320, __rev1_320, __noswap_splatq_lane_s16(__rev2_320, __p3_320)); \
47336 __ret_320 = __builtin_shufflevector(__ret_320, __ret_320, 7, 6, 5, 4, 3, 2, 1, 0); \
47337 __ret_320; \
48033#define vld2q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
48034 poly64x2x2_t __ret; \
48035 poly64x2x2_t __s1 = __p1; \
48036 poly64x2x2_t __rev1; \
48037 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
48038 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
48039 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 38); \
48040 \
48041 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
48042 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
48043 __ret; \
4733848044})
4733948045#endif
4734048046
4734148047#ifdef __LITTLE_ENDIAN__
47342#define vqrdmlsh_lane_s32(__p0_321, __p1_321, __p2_321, __p3_321) __extension__ ({ \
47343 int32x2_t __ret_321; \
47344 int32x2_t __s0_321 = __p0_321; \
47345 int32x2_t __s1_321 = __p1_321; \
47346 int32x2_t __s2_321 = __p2_321; \
47347 __ret_321 = vqrdmlsh_s32(__s0_321, __s1_321, splat_lane_s32(__s2_321, __p3_321)); \
47348 __ret_321; \
48048#define vld2q_lane_u8(__p0, __p1, __p2) __extension__ ({ \
48049 uint8x16x2_t __ret; \
48050 uint8x16x2_t __s1 = __p1; \
48051 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 48); \
48052 __ret; \
4734948053})
4735048054#else
47351#define vqrdmlsh_lane_s32(__p0_322, __p1_322, __p2_322, __p3_322) __extension__ ({ \
47352 int32x2_t __ret_322; \
47353 int32x2_t __s0_322 = __p0_322; \
47354 int32x2_t __s1_322 = __p1_322; \
47355 int32x2_t __s2_322 = __p2_322; \
47356 int32x2_t __rev0_322; __rev0_322 = __builtin_shufflevector(__s0_322, __s0_322, 1, 0); \
47357 int32x2_t __rev1_322; __rev1_322 = __builtin_shufflevector(__s1_322, __s1_322, 1, 0); \
47358 int32x2_t __rev2_322; __rev2_322 = __builtin_shufflevector(__s2_322, __s2_322, 1, 0); \
47359 __ret_322 = __noswap_vqrdmlsh_s32(__rev0_322, __rev1_322, __noswap_splat_lane_s32(__rev2_322, __p3_322)); \
47360 __ret_322 = __builtin_shufflevector(__ret_322, __ret_322, 1, 0); \
47361 __ret_322; \
48055#define vld2q_lane_u8(__p0, __p1, __p2) __extension__ ({ \
48056 uint8x16x2_t __ret; \
48057 uint8x16x2_t __s1 = __p1; \
48058 uint8x16x2_t __rev1; \
48059 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48060 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48061 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 48); \
48062 \
48063 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48064 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48065 __ret; \
4736248066})
4736348067#endif
4736448068
4736548069#ifdef __LITTLE_ENDIAN__
47366#define vqrdmlsh_lane_s16(__p0_323, __p1_323, __p2_323, __p3_323) __extension__ ({ \
47367 int16x4_t __ret_323; \
47368 int16x4_t __s0_323 = __p0_323; \
47369 int16x4_t __s1_323 = __p1_323; \
47370 int16x4_t __s2_323 = __p2_323; \
47371 __ret_323 = vqrdmlsh_s16(__s0_323, __s1_323, splat_lane_s16(__s2_323, __p3_323)); \
47372 __ret_323; \
48070#define vld2q_lane_u64(__p0, __p1, __p2) __extension__ ({ \
48071 uint64x2x2_t __ret; \
48072 uint64x2x2_t __s1 = __p1; \
48073 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 51); \
48074 __ret; \
4737348075})
4737448076#else
47375#define vqrdmlsh_lane_s16(__p0_324, __p1_324, __p2_324, __p3_324) __extension__ ({ \
47376 int16x4_t __ret_324; \
47377 int16x4_t __s0_324 = __p0_324; \
47378 int16x4_t __s1_324 = __p1_324; \
47379 int16x4_t __s2_324 = __p2_324; \
47380 int16x4_t __rev0_324; __rev0_324 = __builtin_shufflevector(__s0_324, __s0_324, 3, 2, 1, 0); \
47381 int16x4_t __rev1_324; __rev1_324 = __builtin_shufflevector(__s1_324, __s1_324, 3, 2, 1, 0); \
47382 int16x4_t __rev2_324; __rev2_324 = __builtin_shufflevector(__s2_324, __s2_324, 3, 2, 1, 0); \
47383 __ret_324 = __noswap_vqrdmlsh_s16(__rev0_324, __rev1_324, __noswap_splat_lane_s16(__rev2_324, __p3_324)); \
47384 __ret_324 = __builtin_shufflevector(__ret_324, __ret_324, 3, 2, 1, 0); \
47385 __ret_324; \
48077#define vld2q_lane_u64(__p0, __p1, __p2) __extension__ ({ \
48078 uint64x2x2_t __ret; \
48079 uint64x2x2_t __s1 = __p1; \
48080 uint64x2x2_t __rev1; \
48081 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
48082 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
48083 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 51); \
48084 \
48085 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
48086 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
48087 __ret; \
4738648088})
4738748089#endif
4738848090
47389#endif
47390#if defined(__ARM_FEATURE_QRDMX) && defined(__aarch64__)
47391__ai int32_t vqrdmlahs_s32(int32_t __p0, int32_t __p1, int32_t __p2) {
47392 int32_t __ret;
47393 __ret = (int32_t) __builtin_neon_vqrdmlahs_s32(__p0, __p1, __p2);
47394 return __ret;
47395}
47396__ai int16_t vqrdmlahh_s16(int16_t __p0, int16_t __p1, int16_t __p2) {
47397 int16_t __ret;
47398 __ret = (int16_t) __builtin_neon_vqrdmlahh_s16(__p0, __p1, __p2);
47399 return __ret;
47400}
4740148091#ifdef __LITTLE_ENDIAN__
47402#define vqrdmlahs_lane_s32(__p0_325, __p1_325, __p2_325, __p3_325) __extension__ ({ \
47403 int32_t __ret_325; \
47404 int32_t __s0_325 = __p0_325; \
47405 int32_t __s1_325 = __p1_325; \
47406 int32x2_t __s2_325 = __p2_325; \
47407 __ret_325 = vqrdmlahs_s32(__s0_325, __s1_325, vget_lane_s32(__s2_325, __p3_325)); \
47408 __ret_325; \
48092#define vld2q_lane_s8(__p0, __p1, __p2) __extension__ ({ \
48093 int8x16x2_t __ret; \
48094 int8x16x2_t __s1 = __p1; \
48095 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 32); \
48096 __ret; \
4740948097})
4741048098#else
47411#define vqrdmlahs_lane_s32(__p0_326, __p1_326, __p2_326, __p3_326) __extension__ ({ \
47412 int32_t __ret_326; \
47413 int32_t __s0_326 = __p0_326; \
47414 int32_t __s1_326 = __p1_326; \
47415 int32x2_t __s2_326 = __p2_326; \
47416 int32x2_t __rev2_326; __rev2_326 = __builtin_shufflevector(__s2_326, __s2_326, 1, 0); \
47417 __ret_326 = vqrdmlahs_s32(__s0_326, __s1_326, __noswap_vget_lane_s32(__rev2_326, __p3_326)); \
47418 __ret_326; \
48099#define vld2q_lane_s8(__p0, __p1, __p2) __extension__ ({ \
48100 int8x16x2_t __ret; \
48101 int8x16x2_t __s1 = __p1; \
48102 int8x16x2_t __rev1; \
48103 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48104 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48105 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 32); \
48106 \
48107 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48108 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48109 __ret; \
4741948110})
4742048111#endif
4742148112
4742248113#ifdef __LITTLE_ENDIAN__
47423#define vqrdmlahh_lane_s16(__p0_327, __p1_327, __p2_327, __p3_327) __extension__ ({ \
47424 int16_t __ret_327; \
47425 int16_t __s0_327 = __p0_327; \
47426 int16_t __s1_327 = __p1_327; \
47427 int16x4_t __s2_327 = __p2_327; \
47428 __ret_327 = vqrdmlahh_s16(__s0_327, __s1_327, vget_lane_s16(__s2_327, __p3_327)); \
47429 __ret_327; \
48114#define vld2q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
48115 float64x2x2_t __ret; \
48116 float64x2x2_t __s1 = __p1; \
48117 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 42); \
48118 __ret; \
4743048119})
4743148120#else
47432#define vqrdmlahh_lane_s16(__p0_328, __p1_328, __p2_328, __p3_328) __extension__ ({ \
47433 int16_t __ret_328; \
47434 int16_t __s0_328 = __p0_328; \
47435 int16_t __s1_328 = __p1_328; \
47436 int16x4_t __s2_328 = __p2_328; \
47437 int16x4_t __rev2_328; __rev2_328 = __builtin_shufflevector(__s2_328, __s2_328, 3, 2, 1, 0); \
47438 __ret_328 = vqrdmlahh_s16(__s0_328, __s1_328, __noswap_vget_lane_s16(__rev2_328, __p3_328)); \
47439 __ret_328; \
48121#define vld2q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
48122 float64x2x2_t __ret; \
48123 float64x2x2_t __s1 = __p1; \
48124 float64x2x2_t __rev1; \
48125 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
48126 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
48127 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 42); \
48128 \
48129 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
48130 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
48131 __ret; \
4744048132})
4744148133#endif
4744248134
4744348135#ifdef __LITTLE_ENDIAN__
47444#define vqrdmlahs_laneq_s32(__p0_329, __p1_329, __p2_329, __p3_329) __extension__ ({ \
47445 int32_t __ret_329; \
47446 int32_t __s0_329 = __p0_329; \
47447 int32_t __s1_329 = __p1_329; \
47448 int32x4_t __s2_329 = __p2_329; \
47449 __ret_329 = vqrdmlahs_s32(__s0_329, __s1_329, vgetq_lane_s32(__s2_329, __p3_329)); \
47450 __ret_329; \
48136#define vld2q_lane_s64(__p0, __p1, __p2) __extension__ ({ \
48137 int64x2x2_t __ret; \
48138 int64x2x2_t __s1 = __p1; \
48139 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 35); \
48140 __ret; \
4745148141})
4745248142#else
47453#define vqrdmlahs_laneq_s32(__p0_330, __p1_330, __p2_330, __p3_330) __extension__ ({ \
47454 int32_t __ret_330; \
47455 int32_t __s0_330 = __p0_330; \
47456 int32_t __s1_330 = __p1_330; \
47457 int32x4_t __s2_330 = __p2_330; \
47458 int32x4_t __rev2_330; __rev2_330 = __builtin_shufflevector(__s2_330, __s2_330, 3, 2, 1, 0); \
47459 __ret_330 = vqrdmlahs_s32(__s0_330, __s1_330, __noswap_vgetq_lane_s32(__rev2_330, __p3_330)); \
47460 __ret_330; \
48143#define vld2q_lane_s64(__p0, __p1, __p2) __extension__ ({ \
48144 int64x2x2_t __ret; \
48145 int64x2x2_t __s1 = __p1; \
48146 int64x2x2_t __rev1; \
48147 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
48148 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
48149 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 35); \
48150 \
48151 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
48152 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
48153 __ret; \
4746148154})
4746248155#endif
4746348156
47464#ifdef __LITTLE_ENDIAN__
47465#define vqrdmlahh_laneq_s16(__p0_331, __p1_331, __p2_331, __p3_331) __extension__ ({ \
47466 int16_t __ret_331; \
47467 int16_t __s0_331 = __p0_331; \
47468 int16_t __s1_331 = __p1_331; \
47469 int16x8_t __s2_331 = __p2_331; \
47470 __ret_331 = vqrdmlahh_s16(__s0_331, __s1_331, vgetq_lane_s16(__s2_331, __p3_331)); \
47471 __ret_331; \
48157#define vld2_lane_u64(__p0, __p1, __p2) __extension__ ({ \
48158 uint64x1x2_t __ret; \
48159 uint64x1x2_t __s1 = __p1; \
48160 __builtin_neon_vld2_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], __p2, 19); \
48161 __ret; \
4747248162})
47473#else
47474#define vqrdmlahh_laneq_s16(__p0_332, __p1_332, __p2_332, __p3_332) __extension__ ({ \
47475 int16_t __ret_332; \
47476 int16_t __s0_332 = __p0_332; \
47477 int16_t __s1_332 = __p1_332; \
47478 int16x8_t __s2_332 = __p2_332; \
47479 int16x8_t __rev2_332; __rev2_332 = __builtin_shufflevector(__s2_332, __s2_332, 7, 6, 5, 4, 3, 2, 1, 0); \
47480 __ret_332 = vqrdmlahh_s16(__s0_332, __s1_332, __noswap_vgetq_lane_s16(__rev2_332, __p3_332)); \
47481 __ret_332; \
48163#define vld2_lane_f64(__p0, __p1, __p2) __extension__ ({ \
48164 float64x1x2_t __ret; \
48165 float64x1x2_t __s1 = __p1; \
48166 __builtin_neon_vld2_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], __p2, 10); \
48167 __ret; \
4748248168})
47483#endif
47484
47485#ifdef __LITTLE_ENDIAN__
47486#define vqrdmlahq_laneq_s32(__p0_333, __p1_333, __p2_333, __p3_333) __extension__ ({ \
47487 int32x4_t __ret_333; \
47488 int32x4_t __s0_333 = __p0_333; \
47489 int32x4_t __s1_333 = __p1_333; \
47490 int32x4_t __s2_333 = __p2_333; \
47491 __ret_333 = vqrdmlahq_s32(__s0_333, __s1_333, splatq_laneq_s32(__s2_333, __p3_333)); \
47492 __ret_333; \
48169#define vld2_lane_s64(__p0, __p1, __p2) __extension__ ({ \
48170 int64x1x2_t __ret; \
48171 int64x1x2_t __s1 = __p1; \
48172 __builtin_neon_vld2_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], __p2, 3); \
48173 __ret; \
4749348174})
47494#else
47495#define vqrdmlahq_laneq_s32(__p0_334, __p1_334, __p2_334, __p3_334) __extension__ ({ \
47496 int32x4_t __ret_334; \
47497 int32x4_t __s0_334 = __p0_334; \
47498 int32x4_t __s1_334 = __p1_334; \
47499 int32x4_t __s2_334 = __p2_334; \
47500 int32x4_t __rev0_334; __rev0_334 = __builtin_shufflevector(__s0_334, __s0_334, 3, 2, 1, 0); \
47501 int32x4_t __rev1_334; __rev1_334 = __builtin_shufflevector(__s1_334, __s1_334, 3, 2, 1, 0); \
47502 int32x4_t __rev2_334; __rev2_334 = __builtin_shufflevector(__s2_334, __s2_334, 3, 2, 1, 0); \
47503 __ret_334 = __noswap_vqrdmlahq_s32(__rev0_334, __rev1_334, __noswap_splatq_laneq_s32(__rev2_334, __p3_334)); \
47504 __ret_334 = __builtin_shufflevector(__ret_334, __ret_334, 3, 2, 1, 0); \
47505 __ret_334; \
48175#define vld3_p64(__p0) __extension__ ({ \
48176 poly64x1x3_t __ret; \
48177 __builtin_neon_vld3_v(&__ret, __p0, 6); \
48178 __ret; \
4750648179})
47507#endif
47508
4750948180#ifdef __LITTLE_ENDIAN__
47510#define vqrdmlahq_laneq_s16(__p0_335, __p1_335, __p2_335, __p3_335) __extension__ ({ \
47511 int16x8_t __ret_335; \
47512 int16x8_t __s0_335 = __p0_335; \
47513 int16x8_t __s1_335 = __p1_335; \
47514 int16x8_t __s2_335 = __p2_335; \
47515 __ret_335 = vqrdmlahq_s16(__s0_335, __s1_335, splatq_laneq_s16(__s2_335, __p3_335)); \
47516 __ret_335; \
48181#define vld3q_p64(__p0) __extension__ ({ \
48182 poly64x2x3_t __ret; \
48183 __builtin_neon_vld3q_v(&__ret, __p0, 38); \
48184 __ret; \
4751748185})
4751848186#else
47519#define vqrdmlahq_laneq_s16(__p0_336, __p1_336, __p2_336, __p3_336) __extension__ ({ \
47520 int16x8_t __ret_336; \
47521 int16x8_t __s0_336 = __p0_336; \
47522 int16x8_t __s1_336 = __p1_336; \
47523 int16x8_t __s2_336 = __p2_336; \
47524 int16x8_t __rev0_336; __rev0_336 = __builtin_shufflevector(__s0_336, __s0_336, 7, 6, 5, 4, 3, 2, 1, 0); \
47525 int16x8_t __rev1_336; __rev1_336 = __builtin_shufflevector(__s1_336, __s1_336, 7, 6, 5, 4, 3, 2, 1, 0); \
47526 int16x8_t __rev2_336; __rev2_336 = __builtin_shufflevector(__s2_336, __s2_336, 7, 6, 5, 4, 3, 2, 1, 0); \
47527 __ret_336 = __noswap_vqrdmlahq_s16(__rev0_336, __rev1_336, __noswap_splatq_laneq_s16(__rev2_336, __p3_336)); \
47528 __ret_336 = __builtin_shufflevector(__ret_336, __ret_336, 7, 6, 5, 4, 3, 2, 1, 0); \
47529 __ret_336; \
48187#define vld3q_p64(__p0) __extension__ ({ \
48188 poly64x2x3_t __ret; \
48189 __builtin_neon_vld3q_v(&__ret, __p0, 38); \
48190 \
48191 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
48192 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
48193 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
48194 __ret; \
4753048195})
4753148196#endif
4753248197
4753348198#ifdef __LITTLE_ENDIAN__
47534#define vqrdmlah_laneq_s32(__p0_337, __p1_337, __p2_337, __p3_337) __extension__ ({ \
47535 int32x2_t __ret_337; \
47536 int32x2_t __s0_337 = __p0_337; \
47537 int32x2_t __s1_337 = __p1_337; \
47538 int32x4_t __s2_337 = __p2_337; \
47539 __ret_337 = vqrdmlah_s32(__s0_337, __s1_337, splat_laneq_s32(__s2_337, __p3_337)); \
47540 __ret_337; \
48199#define vld3q_u64(__p0) __extension__ ({ \
48200 uint64x2x3_t __ret; \
48201 __builtin_neon_vld3q_v(&__ret, __p0, 51); \
48202 __ret; \
4754148203})
4754248204#else
47543#define vqrdmlah_laneq_s32(__p0_338, __p1_338, __p2_338, __p3_338) __extension__ ({ \
47544 int32x2_t __ret_338; \
47545 int32x2_t __s0_338 = __p0_338; \
47546 int32x2_t __s1_338 = __p1_338; \
47547 int32x4_t __s2_338 = __p2_338; \
47548 int32x2_t __rev0_338; __rev0_338 = __builtin_shufflevector(__s0_338, __s0_338, 1, 0); \
47549 int32x2_t __rev1_338; __rev1_338 = __builtin_shufflevector(__s1_338, __s1_338, 1, 0); \
47550 int32x4_t __rev2_338; __rev2_338 = __builtin_shufflevector(__s2_338, __s2_338, 3, 2, 1, 0); \
47551 __ret_338 = __noswap_vqrdmlah_s32(__rev0_338, __rev1_338, __noswap_splat_laneq_s32(__rev2_338, __p3_338)); \
47552 __ret_338 = __builtin_shufflevector(__ret_338, __ret_338, 1, 0); \
47553 __ret_338; \
48205#define vld3q_u64(__p0) __extension__ ({ \
48206 uint64x2x3_t __ret; \
48207 __builtin_neon_vld3q_v(&__ret, __p0, 51); \
48208 \
48209 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
48210 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
48211 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
48212 __ret; \
4755448213})
4755548214#endif
4755648215
4755748216#ifdef __LITTLE_ENDIAN__
47558#define vqrdmlah_laneq_s16(__p0_339, __p1_339, __p2_339, __p3_339) __extension__ ({ \
47559 int16x4_t __ret_339; \
47560 int16x4_t __s0_339 = __p0_339; \
47561 int16x4_t __s1_339 = __p1_339; \
47562 int16x8_t __s2_339 = __p2_339; \
47563 __ret_339 = vqrdmlah_s16(__s0_339, __s1_339, splat_laneq_s16(__s2_339, __p3_339)); \
47564 __ret_339; \
48217#define vld3q_f64(__p0) __extension__ ({ \
48218 float64x2x3_t __ret; \
48219 __builtin_neon_vld3q_v(&__ret, __p0, 42); \
48220 __ret; \
4756548221})
4756648222#else
47567#define vqrdmlah_laneq_s16(__p0_340, __p1_340, __p2_340, __p3_340) __extension__ ({ \
47568 int16x4_t __ret_340; \
47569 int16x4_t __s0_340 = __p0_340; \
47570 int16x4_t __s1_340 = __p1_340; \
47571 int16x8_t __s2_340 = __p2_340; \
47572 int16x4_t __rev0_340; __rev0_340 = __builtin_shufflevector(__s0_340, __s0_340, 3, 2, 1, 0); \
47573 int16x4_t __rev1_340; __rev1_340 = __builtin_shufflevector(__s1_340, __s1_340, 3, 2, 1, 0); \
47574 int16x8_t __rev2_340; __rev2_340 = __builtin_shufflevector(__s2_340, __s2_340, 7, 6, 5, 4, 3, 2, 1, 0); \
47575 __ret_340 = __noswap_vqrdmlah_s16(__rev0_340, __rev1_340, __noswap_splat_laneq_s16(__rev2_340, __p3_340)); \
47576 __ret_340 = __builtin_shufflevector(__ret_340, __ret_340, 3, 2, 1, 0); \
47577 __ret_340; \
48223#define vld3q_f64(__p0) __extension__ ({ \
48224 float64x2x3_t __ret; \
48225 __builtin_neon_vld3q_v(&__ret, __p0, 42); \
48226 \
48227 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
48228 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
48229 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
48230 __ret; \
4757848231})
4757948232#endif
4758048233
47581__ai int32_t vqrdmlshs_s32(int32_t __p0, int32_t __p1, int32_t __p2) {
47582 int32_t __ret;
47583 __ret = (int32_t) __builtin_neon_vqrdmlshs_s32(__p0, __p1, __p2);
47584 return __ret;
47585}
47586__ai int16_t vqrdmlshh_s16(int16_t __p0, int16_t __p1, int16_t __p2) {
47587 int16_t __ret;
47588 __ret = (int16_t) __builtin_neon_vqrdmlshh_s16(__p0, __p1, __p2);
47589 return __ret;
47590}
4759148234#ifdef __LITTLE_ENDIAN__
47592#define vqrdmlshs_lane_s32(__p0_341, __p1_341, __p2_341, __p3_341) __extension__ ({ \
47593 int32_t __ret_341; \
47594 int32_t __s0_341 = __p0_341; \
47595 int32_t __s1_341 = __p1_341; \
47596 int32x2_t __s2_341 = __p2_341; \
47597 __ret_341 = vqrdmlshs_s32(__s0_341, __s1_341, vget_lane_s32(__s2_341, __p3_341)); \
47598 __ret_341; \
48235#define vld3q_s64(__p0) __extension__ ({ \
48236 int64x2x3_t __ret; \
48237 __builtin_neon_vld3q_v(&__ret, __p0, 35); \
48238 __ret; \
4759948239})
4760048240#else
47601#define vqrdmlshs_lane_s32(__p0_342, __p1_342, __p2_342, __p3_342) __extension__ ({ \
47602 int32_t __ret_342; \
47603 int32_t __s0_342 = __p0_342; \
47604 int32_t __s1_342 = __p1_342; \
47605 int32x2_t __s2_342 = __p2_342; \
47606 int32x2_t __rev2_342; __rev2_342 = __builtin_shufflevector(__s2_342, __s2_342, 1, 0); \
47607 __ret_342 = vqrdmlshs_s32(__s0_342, __s1_342, __noswap_vget_lane_s32(__rev2_342, __p3_342)); \
47608 __ret_342; \
48241#define vld3q_s64(__p0) __extension__ ({ \
48242 int64x2x3_t __ret; \
48243 __builtin_neon_vld3q_v(&__ret, __p0, 35); \
48244 \
48245 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
48246 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
48247 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
48248 __ret; \
4760948249})
4761048250#endif
4761148251
47612#ifdef __LITTLE_ENDIAN__
47613#define vqrdmlshh_lane_s16(__p0_343, __p1_343, __p2_343, __p3_343) __extension__ ({ \
47614 int16_t __ret_343; \
47615 int16_t __s0_343 = __p0_343; \
47616 int16_t __s1_343 = __p1_343; \
47617 int16x4_t __s2_343 = __p2_343; \
47618 __ret_343 = vqrdmlshh_s16(__s0_343, __s1_343, vget_lane_s16(__s2_343, __p3_343)); \
47619 __ret_343; \
48252#define vld3_f64(__p0) __extension__ ({ \
48253 float64x1x3_t __ret; \
48254 __builtin_neon_vld3_v(&__ret, __p0, 10); \
48255 __ret; \
4762048256})
47621#else
47622#define vqrdmlshh_lane_s16(__p0_344, __p1_344, __p2_344, __p3_344) __extension__ ({ \
47623 int16_t __ret_344; \
47624 int16_t __s0_344 = __p0_344; \
47625 int16_t __s1_344 = __p1_344; \
47626 int16x4_t __s2_344 = __p2_344; \
47627 int16x4_t __rev2_344; __rev2_344 = __builtin_shufflevector(__s2_344, __s2_344, 3, 2, 1, 0); \
47628 __ret_344 = vqrdmlshh_s16(__s0_344, __s1_344, __noswap_vget_lane_s16(__rev2_344, __p3_344)); \
47629 __ret_344; \
48257#define vld3_dup_p64(__p0) __extension__ ({ \
48258 poly64x1x3_t __ret; \
48259 __builtin_neon_vld3_dup_v(&__ret, __p0, 6); \
48260 __ret; \
4763048261})
47631#endif
47632
4763348262#ifdef __LITTLE_ENDIAN__
47634#define vqrdmlshs_laneq_s32(__p0_345, __p1_345, __p2_345, __p3_345) __extension__ ({ \
47635 int32_t __ret_345; \
47636 int32_t __s0_345 = __p0_345; \
47637 int32_t __s1_345 = __p1_345; \
47638 int32x4_t __s2_345 = __p2_345; \
47639 __ret_345 = vqrdmlshs_s32(__s0_345, __s1_345, vgetq_lane_s32(__s2_345, __p3_345)); \
47640 __ret_345; \
48263#define vld3q_dup_p64(__p0) __extension__ ({ \
48264 poly64x2x3_t __ret; \
48265 __builtin_neon_vld3q_dup_v(&__ret, __p0, 38); \
48266 __ret; \
4764148267})
4764248268#else
47643#define vqrdmlshs_laneq_s32(__p0_346, __p1_346, __p2_346, __p3_346) __extension__ ({ \
47644 int32_t __ret_346; \
47645 int32_t __s0_346 = __p0_346; \
47646 int32_t __s1_346 = __p1_346; \
47647 int32x4_t __s2_346 = __p2_346; \
47648 int32x4_t __rev2_346; __rev2_346 = __builtin_shufflevector(__s2_346, __s2_346, 3, 2, 1, 0); \
47649 __ret_346 = vqrdmlshs_s32(__s0_346, __s1_346, __noswap_vgetq_lane_s32(__rev2_346, __p3_346)); \
47650 __ret_346; \
48269#define vld3q_dup_p64(__p0) __extension__ ({ \
48270 poly64x2x3_t __ret; \
48271 __builtin_neon_vld3q_dup_v(&__ret, __p0, 38); \
48272 \
48273 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
48274 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
48275 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
48276 __ret; \
4765148277})
4765248278#endif
4765348279
4765448280#ifdef __LITTLE_ENDIAN__
47655#define vqrdmlshh_laneq_s16(__p0_347, __p1_347, __p2_347, __p3_347) __extension__ ({ \
47656 int16_t __ret_347; \
47657 int16_t __s0_347 = __p0_347; \
47658 int16_t __s1_347 = __p1_347; \
47659 int16x8_t __s2_347 = __p2_347; \
47660 __ret_347 = vqrdmlshh_s16(__s0_347, __s1_347, vgetq_lane_s16(__s2_347, __p3_347)); \
47661 __ret_347; \
48281#define vld3q_dup_f64(__p0) __extension__ ({ \
48282 float64x2x3_t __ret; \
48283 __builtin_neon_vld3q_dup_v(&__ret, __p0, 42); \
48284 __ret; \
4766248285})
4766348286#else
47664#define vqrdmlshh_laneq_s16(__p0_348, __p1_348, __p2_348, __p3_348) __extension__ ({ \
47665 int16_t __ret_348; \
47666 int16_t __s0_348 = __p0_348; \
47667 int16_t __s1_348 = __p1_348; \
47668 int16x8_t __s2_348 = __p2_348; \
47669 int16x8_t __rev2_348; __rev2_348 = __builtin_shufflevector(__s2_348, __s2_348, 7, 6, 5, 4, 3, 2, 1, 0); \
47670 __ret_348 = vqrdmlshh_s16(__s0_348, __s1_348, __noswap_vgetq_lane_s16(__rev2_348, __p3_348)); \
47671 __ret_348; \
48287#define vld3q_dup_f64(__p0) __extension__ ({ \
48288 float64x2x3_t __ret; \
48289 __builtin_neon_vld3q_dup_v(&__ret, __p0, 42); \
48290 \
48291 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
48292 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
48293 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
48294 __ret; \
4767248295})
4767348296#endif
4767448297
47675#ifdef __LITTLE_ENDIAN__
47676#define vqrdmlshq_laneq_s32(__p0_349, __p1_349, __p2_349, __p3_349) __extension__ ({ \
47677 int32x4_t __ret_349; \
47678 int32x4_t __s0_349 = __p0_349; \
47679 int32x4_t __s1_349 = __p1_349; \
47680 int32x4_t __s2_349 = __p2_349; \
47681 __ret_349 = vqrdmlshq_s32(__s0_349, __s1_349, splatq_laneq_s32(__s2_349, __p3_349)); \
47682 __ret_349; \
48298#define vld3_dup_f64(__p0) __extension__ ({ \
48299 float64x1x3_t __ret; \
48300 __builtin_neon_vld3_dup_v(&__ret, __p0, 10); \
48301 __ret; \
4768348302})
47684#else
47685#define vqrdmlshq_laneq_s32(__p0_350, __p1_350, __p2_350, __p3_350) __extension__ ({ \
47686 int32x4_t __ret_350; \
47687 int32x4_t __s0_350 = __p0_350; \
47688 int32x4_t __s1_350 = __p1_350; \
47689 int32x4_t __s2_350 = __p2_350; \
47690 int32x4_t __rev0_350; __rev0_350 = __builtin_shufflevector(__s0_350, __s0_350, 3, 2, 1, 0); \
47691 int32x4_t __rev1_350; __rev1_350 = __builtin_shufflevector(__s1_350, __s1_350, 3, 2, 1, 0); \
47692 int32x4_t __rev2_350; __rev2_350 = __builtin_shufflevector(__s2_350, __s2_350, 3, 2, 1, 0); \
47693 __ret_350 = __noswap_vqrdmlshq_s32(__rev0_350, __rev1_350, __noswap_splatq_laneq_s32(__rev2_350, __p3_350)); \
47694 __ret_350 = __builtin_shufflevector(__ret_350, __ret_350, 3, 2, 1, 0); \
47695 __ret_350; \
48303#define vld3_lane_p64(__p0, __p1, __p2) __extension__ ({ \
48304 poly64x1x3_t __ret; \
48305 poly64x1x3_t __s1 = __p1; \
48306 __builtin_neon_vld3_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], __p2, 6); \
48307 __ret; \
4769648308})
47697#endif
47698
4769948309#ifdef __LITTLE_ENDIAN__
47700#define vqrdmlshq_laneq_s16(__p0_351, __p1_351, __p2_351, __p3_351) __extension__ ({ \
47701 int16x8_t __ret_351; \
47702 int16x8_t __s0_351 = __p0_351; \
47703 int16x8_t __s1_351 = __p1_351; \
47704 int16x8_t __s2_351 = __p2_351; \
47705 __ret_351 = vqrdmlshq_s16(__s0_351, __s1_351, splatq_laneq_s16(__s2_351, __p3_351)); \
47706 __ret_351; \
48310#define vld3q_lane_p8(__p0, __p1, __p2) __extension__ ({ \
48311 poly8x16x3_t __ret; \
48312 poly8x16x3_t __s1 = __p1; \
48313 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 36); \
48314 __ret; \
4770748315})
4770848316#else
47709#define vqrdmlshq_laneq_s16(__p0_352, __p1_352, __p2_352, __p3_352) __extension__ ({ \
47710 int16x8_t __ret_352; \
47711 int16x8_t __s0_352 = __p0_352; \
47712 int16x8_t __s1_352 = __p1_352; \
47713 int16x8_t __s2_352 = __p2_352; \
47714 int16x8_t __rev0_352; __rev0_352 = __builtin_shufflevector(__s0_352, __s0_352, 7, 6, 5, 4, 3, 2, 1, 0); \
47715 int16x8_t __rev1_352; __rev1_352 = __builtin_shufflevector(__s1_352, __s1_352, 7, 6, 5, 4, 3, 2, 1, 0); \
47716 int16x8_t __rev2_352; __rev2_352 = __builtin_shufflevector(__s2_352, __s2_352, 7, 6, 5, 4, 3, 2, 1, 0); \
47717 __ret_352 = __noswap_vqrdmlshq_s16(__rev0_352, __rev1_352, __noswap_splatq_laneq_s16(__rev2_352, __p3_352)); \
47718 __ret_352 = __builtin_shufflevector(__ret_352, __ret_352, 7, 6, 5, 4, 3, 2, 1, 0); \
47719 __ret_352; \
48317#define vld3q_lane_p8(__p0, __p1, __p2) __extension__ ({ \
48318 poly8x16x3_t __ret; \
48319 poly8x16x3_t __s1 = __p1; \
48320 poly8x16x3_t __rev1; \
48321 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48322 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48323 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48324 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 36); \
48325 \
48326 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48327 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48328 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48329 __ret; \
4772048330})
4772148331#endif
4772248332
4772348333#ifdef __LITTLE_ENDIAN__
47724#define vqrdmlsh_laneq_s32(__p0_353, __p1_353, __p2_353, __p3_353) __extension__ ({ \
47725 int32x2_t __ret_353; \
47726 int32x2_t __s0_353 = __p0_353; \
47727 int32x2_t __s1_353 = __p1_353; \
47728 int32x4_t __s2_353 = __p2_353; \
47729 __ret_353 = vqrdmlsh_s32(__s0_353, __s1_353, splat_laneq_s32(__s2_353, __p3_353)); \
47730 __ret_353; \
48334#define vld3q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
48335 poly64x2x3_t __ret; \
48336 poly64x2x3_t __s1 = __p1; \
48337 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 38); \
48338 __ret; \
4773148339})
4773248340#else
47733#define vqrdmlsh_laneq_s32(__p0_354, __p1_354, __p2_354, __p3_354) __extension__ ({ \
47734 int32x2_t __ret_354; \
47735 int32x2_t __s0_354 = __p0_354; \
47736 int32x2_t __s1_354 = __p1_354; \
47737 int32x4_t __s2_354 = __p2_354; \
47738 int32x2_t __rev0_354; __rev0_354 = __builtin_shufflevector(__s0_354, __s0_354, 1, 0); \
47739 int32x2_t __rev1_354; __rev1_354 = __builtin_shufflevector(__s1_354, __s1_354, 1, 0); \
47740 int32x4_t __rev2_354; __rev2_354 = __builtin_shufflevector(__s2_354, __s2_354, 3, 2, 1, 0); \
47741 __ret_354 = __noswap_vqrdmlsh_s32(__rev0_354, __rev1_354, __noswap_splat_laneq_s32(__rev2_354, __p3_354)); \
47742 __ret_354 = __builtin_shufflevector(__ret_354, __ret_354, 1, 0); \
47743 __ret_354; \
48341#define vld3q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
48342 poly64x2x3_t __ret; \
48343 poly64x2x3_t __s1 = __p1; \
48344 poly64x2x3_t __rev1; \
48345 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
48346 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
48347 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
48348 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 38); \
48349 \
48350 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
48351 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
48352 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
48353 __ret; \
4774448354})
4774548355#endif
4774648356
4774748357#ifdef __LITTLE_ENDIAN__
47748#define vqrdmlsh_laneq_s16(__p0_355, __p1_355, __p2_355, __p3_355) __extension__ ({ \
47749 int16x4_t __ret_355; \
47750 int16x4_t __s0_355 = __p0_355; \
47751 int16x4_t __s1_355 = __p1_355; \
47752 int16x8_t __s2_355 = __p2_355; \
47753 __ret_355 = vqrdmlsh_s16(__s0_355, __s1_355, splat_laneq_s16(__s2_355, __p3_355)); \
47754 __ret_355; \
48358#define vld3q_lane_u8(__p0, __p1, __p2) __extension__ ({ \
48359 uint8x16x3_t __ret; \
48360 uint8x16x3_t __s1 = __p1; \
48361 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 48); \
48362 __ret; \
4775548363})
4775648364#else
47757#define vqrdmlsh_laneq_s16(__p0_356, __p1_356, __p2_356, __p3_356) __extension__ ({ \
47758 int16x4_t __ret_356; \
47759 int16x4_t __s0_356 = __p0_356; \
47760 int16x4_t __s1_356 = __p1_356; \
47761 int16x8_t __s2_356 = __p2_356; \
47762 int16x4_t __rev0_356; __rev0_356 = __builtin_shufflevector(__s0_356, __s0_356, 3, 2, 1, 0); \
47763 int16x4_t __rev1_356; __rev1_356 = __builtin_shufflevector(__s1_356, __s1_356, 3, 2, 1, 0); \
47764 int16x8_t __rev2_356; __rev2_356 = __builtin_shufflevector(__s2_356, __s2_356, 7, 6, 5, 4, 3, 2, 1, 0); \
47765 __ret_356 = __noswap_vqrdmlsh_s16(__rev0_356, __rev1_356, __noswap_splat_laneq_s16(__rev2_356, __p3_356)); \
47766 __ret_356 = __builtin_shufflevector(__ret_356, __ret_356, 3, 2, 1, 0); \
47767 __ret_356; \
48365#define vld3q_lane_u8(__p0, __p1, __p2) __extension__ ({ \
48366 uint8x16x3_t __ret; \
48367 uint8x16x3_t __s1 = __p1; \
48368 uint8x16x3_t __rev1; \
48369 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48370 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48371 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48372 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 48); \
48373 \
48374 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48375 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48376 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48377 __ret; \
4776848378})
4776948379#endif
4777048380
47771#endif
47772#if defined(__aarch64__)
4777348381#ifdef __LITTLE_ENDIAN__
47774__ai float64x2_t vabdq_f64(float64x2_t __p0, float64x2_t __p1) {
47775 float64x2_t __ret;
47776 __ret = (float64x2_t) __builtin_neon_vabdq_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
47777 return __ret;
47778}
48382#define vld3q_lane_u64(__p0, __p1, __p2) __extension__ ({ \
48383 uint64x2x3_t __ret; \
48384 uint64x2x3_t __s1 = __p1; \
48385 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 51); \
48386 __ret; \
48387})
4777948388#else
47780__ai float64x2_t vabdq_f64(float64x2_t __p0, float64x2_t __p1) {
47781 float64x2_t __ret;
47782 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
47783 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
47784 __ret = (float64x2_t) __builtin_neon_vabdq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
47785 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
47786 return __ret;
47787}
48389#define vld3q_lane_u64(__p0, __p1, __p2) __extension__ ({ \
48390 uint64x2x3_t __ret; \
48391 uint64x2x3_t __s1 = __p1; \
48392 uint64x2x3_t __rev1; \
48393 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
48394 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
48395 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
48396 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 51); \
48397 \
48398 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
48399 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
48400 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
48401 __ret; \
48402})
4778848403#endif
4778948404
47790__ai float64x1_t vabd_f64(float64x1_t __p0, float64x1_t __p1) {
47791 float64x1_t __ret;
47792 __ret = (float64x1_t) __builtin_neon_vabd_v((int8x8_t)__p0, (int8x8_t)__p1, 10);
47793 return __ret;
47794}
47795__ai float64_t vabdd_f64(float64_t __p0, float64_t __p1) {
47796 float64_t __ret;
47797 __ret = (float64_t) __builtin_neon_vabdd_f64(__p0, __p1);
47798 return __ret;
47799}
47800__ai float32_t vabds_f32(float32_t __p0, float32_t __p1) {
47801 float32_t __ret;
47802 __ret = (float32_t) __builtin_neon_vabds_f32(__p0, __p1);
47803 return __ret;
47804}
4780548405#ifdef __LITTLE_ENDIAN__
47806__ai float64x2_t vabsq_f64(float64x2_t __p0) {
47807 float64x2_t __ret;
47808 __ret = (float64x2_t) __builtin_neon_vabsq_v((int8x16_t)__p0, 42);
47809 return __ret;
47810}
48406#define vld3q_lane_s8(__p0, __p1, __p2) __extension__ ({ \
48407 int8x16x3_t __ret; \
48408 int8x16x3_t __s1 = __p1; \
48409 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 32); \
48410 __ret; \
48411})
4781148412#else
47812__ai float64x2_t vabsq_f64(float64x2_t __p0) {
47813 float64x2_t __ret;
47814 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
47815 __ret = (float64x2_t) __builtin_neon_vabsq_v((int8x16_t)__rev0, 42);
47816 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
47817 return __ret;
47818}
48413#define vld3q_lane_s8(__p0, __p1, __p2) __extension__ ({ \
48414 int8x16x3_t __ret; \
48415 int8x16x3_t __s1 = __p1; \
48416 int8x16x3_t __rev1; \
48417 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48418 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48419 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48420 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 32); \
48421 \
48422 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48423 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48424 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48425 __ret; \
48426})
4781948427#endif
4782048428
4782148429#ifdef __LITTLE_ENDIAN__
47822__ai int64x2_t vabsq_s64(int64x2_t __p0) {
47823 int64x2_t __ret;
47824 __ret = (int64x2_t) __builtin_neon_vabsq_v((int8x16_t)__p0, 35);
47825 return __ret;
47826}
48430#define vld3q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
48431 float64x2x3_t __ret; \
48432 float64x2x3_t __s1 = __p1; \
48433 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 42); \
48434 __ret; \
48435})
4782748436#else
47828__ai int64x2_t vabsq_s64(int64x2_t __p0) {
47829 int64x2_t __ret;
47830 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
47831 __ret = (int64x2_t) __builtin_neon_vabsq_v((int8x16_t)__rev0, 35);
47832 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
47833 return __ret;
47834}
48437#define vld3q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
48438 float64x2x3_t __ret; \
48439 float64x2x3_t __s1 = __p1; \
48440 float64x2x3_t __rev1; \
48441 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
48442 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
48443 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
48444 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 42); \
48445 \
48446 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
48447 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
48448 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
48449 __ret; \
48450})
4783548451#endif
4783648452
47837__ai float64x1_t vabs_f64(float64x1_t __p0) {
47838 float64x1_t __ret;
47839 __ret = (float64x1_t) __builtin_neon_vabs_v((int8x8_t)__p0, 10);
47840 return __ret;
47841}
47842__ai int64x1_t vabs_s64(int64x1_t __p0) {
47843 int64x1_t __ret;
47844 __ret = (int64x1_t) __builtin_neon_vabs_v((int8x8_t)__p0, 3);
47845 return __ret;
47846}
47847__ai int64_t vabsd_s64(int64_t __p0) {
47848 int64_t __ret;
47849 __ret = (int64_t) __builtin_neon_vabsd_s64(__p0);
47850 return __ret;
47851}
4785248453#ifdef __LITTLE_ENDIAN__
47853__ai float64x2_t vaddq_f64(float64x2_t __p0, float64x2_t __p1) {
47854 float64x2_t __ret;
47855 __ret = __p0 + __p1;
47856 return __ret;
47857}
47858#else
47859__ai float64x2_t vaddq_f64(float64x2_t __p0, float64x2_t __p1) {
47860 float64x2_t __ret;
47861 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
47862 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
47863 __ret = __rev0 + __rev1;
47864 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
47865 return __ret;
47866}
48454#define vld3q_lane_s64(__p0, __p1, __p2) __extension__ ({ \
48455 int64x2x3_t __ret; \
48456 int64x2x3_t __s1 = __p1; \
48457 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 35); \
48458 __ret; \
48459})
48460#else
48461#define vld3q_lane_s64(__p0, __p1, __p2) __extension__ ({ \
48462 int64x2x3_t __ret; \
48463 int64x2x3_t __s1 = __p1; \
48464 int64x2x3_t __rev1; \
48465 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
48466 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
48467 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
48468 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 35); \
48469 \
48470 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
48471 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
48472 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
48473 __ret; \
48474})
4786748475#endif
4786848476
47869__ai float64x1_t vadd_f64(float64x1_t __p0, float64x1_t __p1) {
47870 float64x1_t __ret;
47871 __ret = __p0 + __p1;
47872 return __ret;
47873}
47874__ai uint64_t vaddd_u64(uint64_t __p0, uint64_t __p1) {
47875 uint64_t __ret;
47876 __ret = (uint64_t) __builtin_neon_vaddd_u64(__p0, __p1);
47877 return __ret;
47878}
47879__ai int64_t vaddd_s64(int64_t __p0, int64_t __p1) {
47880 int64_t __ret;
47881 __ret = (int64_t) __builtin_neon_vaddd_s64(__p0, __p1);
47882 return __ret;
47883}
47884__ai poly128_t vaddq_p128(poly128_t __p0, poly128_t __p1) {
47885 poly128_t __ret;
47886 __ret = (poly128_t) __builtin_neon_vaddq_p128(__p0, __p1);
47887 return __ret;
47888}
48477#define vld3_lane_u64(__p0, __p1, __p2) __extension__ ({ \
48478 uint64x1x3_t __ret; \
48479 uint64x1x3_t __s1 = __p1; \
48480 __builtin_neon_vld3_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], __p2, 19); \
48481 __ret; \
48482})
48483#define vld3_lane_f64(__p0, __p1, __p2) __extension__ ({ \
48484 float64x1x3_t __ret; \
48485 float64x1x3_t __s1 = __p1; \
48486 __builtin_neon_vld3_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], __p2, 10); \
48487 __ret; \
48488})
48489#define vld3_lane_s64(__p0, __p1, __p2) __extension__ ({ \
48490 int64x1x3_t __ret; \
48491 int64x1x3_t __s1 = __p1; \
48492 __builtin_neon_vld3_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], __p2, 3); \
48493 __ret; \
48494})
48495#define vld4_p64(__p0) __extension__ ({ \
48496 poly64x1x4_t __ret; \
48497 __builtin_neon_vld4_v(&__ret, __p0, 6); \
48498 __ret; \
48499})
4788948500#ifdef __LITTLE_ENDIAN__
47890__ai uint16x8_t vaddhn_high_u32(uint16x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
47891 uint16x8_t __ret;
47892 __ret = vcombine_u16(__p0, vaddhn_u32(__p1, __p2));
47893 return __ret;
47894}
48501#define vld4q_p64(__p0) __extension__ ({ \
48502 poly64x2x4_t __ret; \
48503 __builtin_neon_vld4q_v(&__ret, __p0, 38); \
48504 __ret; \
48505})
4789548506#else
47896__ai uint16x8_t vaddhn_high_u32(uint16x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
47897 uint16x8_t __ret;
47898 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
47899 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
47900 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
47901 __ret = __noswap_vcombine_u16(__rev0, __noswap_vaddhn_u32(__rev1, __rev2));
47902 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
47903 return __ret;
47904}
48507#define vld4q_p64(__p0) __extension__ ({ \
48508 poly64x2x4_t __ret; \
48509 __builtin_neon_vld4q_v(&__ret, __p0, 38); \
48510 \
48511 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
48512 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
48513 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
48514 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 1, 0); \
48515 __ret; \
48516})
4790548517#endif
4790648518
4790748519#ifdef __LITTLE_ENDIAN__
47908__ai uint32x4_t vaddhn_high_u64(uint32x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
47909 uint32x4_t __ret;
47910 __ret = vcombine_u32(__p0, vaddhn_u64(__p1, __p2));
47911 return __ret;
47912}
48520#define vld4q_u64(__p0) __extension__ ({ \
48521 uint64x2x4_t __ret; \
48522 __builtin_neon_vld4q_v(&__ret, __p0, 51); \
48523 __ret; \
48524})
4791348525#else
47914__ai uint32x4_t vaddhn_high_u64(uint32x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
47915 uint32x4_t __ret;
47916 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
47917 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
47918 uint64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
47919 __ret = __noswap_vcombine_u32(__rev0, __noswap_vaddhn_u64(__rev1, __rev2));
47920 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
47921 return __ret;
47922}
48526#define vld4q_u64(__p0) __extension__ ({ \
48527 uint64x2x4_t __ret; \
48528 __builtin_neon_vld4q_v(&__ret, __p0, 51); \
48529 \
48530 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
48531 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
48532 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
48533 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 1, 0); \
48534 __ret; \
48535})
4792348536#endif
4792448537
4792548538#ifdef __LITTLE_ENDIAN__
47926__ai uint8x16_t vaddhn_high_u16(uint8x8_t __p0, uint16x8_t __p1, uint16x8_t __p2) {
47927 uint8x16_t __ret;
47928 __ret = vcombine_u8(__p0, vaddhn_u16(__p1, __p2));
47929 return __ret;
47930}
48539#define vld4q_f64(__p0) __extension__ ({ \
48540 float64x2x4_t __ret; \
48541 __builtin_neon_vld4q_v(&__ret, __p0, 42); \
48542 __ret; \
48543})
4793148544#else
47932__ai uint8x16_t vaddhn_high_u16(uint8x8_t __p0, uint16x8_t __p1, uint16x8_t __p2) {
47933 uint8x16_t __ret;
47934 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
47935 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
47936 uint16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
47937 __ret = __noswap_vcombine_u8(__rev0, __noswap_vaddhn_u16(__rev1, __rev2));
47938 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
47939 return __ret;
47940}
48545#define vld4q_f64(__p0) __extension__ ({ \
48546 float64x2x4_t __ret; \
48547 __builtin_neon_vld4q_v(&__ret, __p0, 42); \
48548 \
48549 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
48550 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
48551 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
48552 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 1, 0); \
48553 __ret; \
48554})
4794148555#endif
4794248556
4794348557#ifdef __LITTLE_ENDIAN__
47944__ai int16x8_t vaddhn_high_s32(int16x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
47945 int16x8_t __ret;
47946 __ret = vcombine_s16(__p0, vaddhn_s32(__p1, __p2));
47947 return __ret;
47948}
48558#define vld4q_s64(__p0) __extension__ ({ \
48559 int64x2x4_t __ret; \
48560 __builtin_neon_vld4q_v(&__ret, __p0, 35); \
48561 __ret; \
48562})
4794948563#else
47950__ai int16x8_t vaddhn_high_s32(int16x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
47951 int16x8_t __ret;
47952 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
47953 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
47954 int32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
47955 __ret = __noswap_vcombine_s16(__rev0, __noswap_vaddhn_s32(__rev1, __rev2));
47956 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
47957 return __ret;
47958}
48564#define vld4q_s64(__p0) __extension__ ({ \
48565 int64x2x4_t __ret; \
48566 __builtin_neon_vld4q_v(&__ret, __p0, 35); \
48567 \
48568 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
48569 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
48570 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
48571 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 1, 0); \
48572 __ret; \
48573})
4795948574#endif
4796048575
48576#define vld4_f64(__p0) __extension__ ({ \
48577 float64x1x4_t __ret; \
48578 __builtin_neon_vld4_v(&__ret, __p0, 10); \
48579 __ret; \
48580})
48581#define vld4_dup_p64(__p0) __extension__ ({ \
48582 poly64x1x4_t __ret; \
48583 __builtin_neon_vld4_dup_v(&__ret, __p0, 6); \
48584 __ret; \
48585})
4796148586#ifdef __LITTLE_ENDIAN__
47962__ai int32x4_t vaddhn_high_s64(int32x2_t __p0, int64x2_t __p1, int64x2_t __p2) {
47963 int32x4_t __ret;
47964 __ret = vcombine_s32(__p0, vaddhn_s64(__p1, __p2));
47965 return __ret;
47966}
48587#define vld4q_dup_p64(__p0) __extension__ ({ \
48588 poly64x2x4_t __ret; \
48589 __builtin_neon_vld4q_dup_v(&__ret, __p0, 38); \
48590 __ret; \
48591})
4796748592#else
47968__ai int32x4_t vaddhn_high_s64(int32x2_t __p0, int64x2_t __p1, int64x2_t __p2) {
47969 int32x4_t __ret;
47970 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
47971 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
47972 int64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
47973 __ret = __noswap_vcombine_s32(__rev0, __noswap_vaddhn_s64(__rev1, __rev2));
47974 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
47975 return __ret;
47976}
48593#define vld4q_dup_p64(__p0) __extension__ ({ \
48594 poly64x2x4_t __ret; \
48595 __builtin_neon_vld4q_dup_v(&__ret, __p0, 38); \
48596 \
48597 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
48598 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
48599 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
48600 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 1, 0); \
48601 __ret; \
48602})
4797748603#endif
4797848604
4797948605#ifdef __LITTLE_ENDIAN__
47980__ai int8x16_t vaddhn_high_s16(int8x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
47981 int8x16_t __ret;
47982 __ret = vcombine_s8(__p0, vaddhn_s16(__p1, __p2));
47983 return __ret;
47984}
48606#define vld4q_dup_f64(__p0) __extension__ ({ \
48607 float64x2x4_t __ret; \
48608 __builtin_neon_vld4q_dup_v(&__ret, __p0, 42); \
48609 __ret; \
48610})
4798548611#else
47986__ai int8x16_t vaddhn_high_s16(int8x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
47987 int8x16_t __ret;
47988 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
47989 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
47990 int16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
47991 __ret = __noswap_vcombine_s8(__rev0, __noswap_vaddhn_s16(__rev1, __rev2));
47992 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
47993 return __ret;
47994}
48612#define vld4q_dup_f64(__p0) __extension__ ({ \
48613 float64x2x4_t __ret; \
48614 __builtin_neon_vld4q_dup_v(&__ret, __p0, 42); \
48615 \
48616 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
48617 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
48618 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
48619 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 1, 0); \
48620 __ret; \
48621})
4799548622#endif
4799648623
48624#define vld4_dup_f64(__p0) __extension__ ({ \
48625 float64x1x4_t __ret; \
48626 __builtin_neon_vld4_dup_v(&__ret, __p0, 10); \
48627 __ret; \
48628})
48629#define vld4_lane_p64(__p0, __p1, __p2) __extension__ ({ \
48630 poly64x1x4_t __ret; \
48631 poly64x1x4_t __s1 = __p1; \
48632 __builtin_neon_vld4_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], __p2, 6); \
48633 __ret; \
48634})
4799748635#ifdef __LITTLE_ENDIAN__
47998__ai uint16_t vaddlvq_u8(uint8x16_t __p0) {
47999 uint16_t __ret;
48000 __ret = (uint16_t) __builtin_neon_vaddlvq_u8(__p0);
48001 return __ret;
48002}
48636#define vld4q_lane_p8(__p0, __p1, __p2) __extension__ ({ \
48637 poly8x16x4_t __ret; \
48638 poly8x16x4_t __s1 = __p1; \
48639 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 36); \
48640 __ret; \
48641})
4800348642#else
48004__ai uint16_t vaddlvq_u8(uint8x16_t __p0) {
48005 uint16_t __ret;
48006 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
48007 __ret = (uint16_t) __builtin_neon_vaddlvq_u8(__rev0);
48008 return __ret;
48009}
48643#define vld4q_lane_p8(__p0, __p1, __p2) __extension__ ({ \
48644 poly8x16x4_t __ret; \
48645 poly8x16x4_t __s1 = __p1; \
48646 poly8x16x4_t __rev1; \
48647 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48648 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48649 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48650 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48651 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 36); \
48652 \
48653 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48654 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48655 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48656 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48657 __ret; \
48658})
4801048659#endif
4801148660
4801248661#ifdef __LITTLE_ENDIAN__
48013__ai uint64_t vaddlvq_u32(uint32x4_t __p0) {
48014 uint64_t __ret;
48015 __ret = (uint64_t) __builtin_neon_vaddlvq_u32(__p0);
48016 return __ret;
48017}
48662#define vld4q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
48663 poly64x2x4_t __ret; \
48664 poly64x2x4_t __s1 = __p1; \
48665 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 38); \
48666 __ret; \
48667})
4801848668#else
48019__ai uint64_t vaddlvq_u32(uint32x4_t __p0) {
48020 uint64_t __ret;
48021 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
48022 __ret = (uint64_t) __builtin_neon_vaddlvq_u32(__rev0);
48023 return __ret;
48024}
48669#define vld4q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
48670 poly64x2x4_t __ret; \
48671 poly64x2x4_t __s1 = __p1; \
48672 poly64x2x4_t __rev1; \
48673 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
48674 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
48675 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
48676 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 1, 0); \
48677 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 38); \
48678 \
48679 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
48680 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
48681 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
48682 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 1, 0); \
48683 __ret; \
48684})
4802548685#endif
4802648686
4802748687#ifdef __LITTLE_ENDIAN__
48028__ai uint32_t vaddlvq_u16(uint16x8_t __p0) {
48029 uint32_t __ret;
48030 __ret = (uint32_t) __builtin_neon_vaddlvq_u16(__p0);
48031 return __ret;
48032}
48688#define vld4q_lane_u8(__p0, __p1, __p2) __extension__ ({ \
48689 uint8x16x4_t __ret; \
48690 uint8x16x4_t __s1 = __p1; \
48691 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 48); \
48692 __ret; \
48693})
4803348694#else
48034__ai uint32_t vaddlvq_u16(uint16x8_t __p0) {
48035 uint32_t __ret;
48036 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
48037 __ret = (uint32_t) __builtin_neon_vaddlvq_u16(__rev0);
48038 return __ret;
48039}
48695#define vld4q_lane_u8(__p0, __p1, __p2) __extension__ ({ \
48696 uint8x16x4_t __ret; \
48697 uint8x16x4_t __s1 = __p1; \
48698 uint8x16x4_t __rev1; \
48699 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48700 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48701 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48702 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48703 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 48); \
48704 \
48705 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48706 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48707 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48708 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48709 __ret; \
48710})
4804048711#endif
4804148712
4804248713#ifdef __LITTLE_ENDIAN__
48043__ai int16_t vaddlvq_s8(int8x16_t __p0) {
48044 int16_t __ret;
48045 __ret = (int16_t) __builtin_neon_vaddlvq_s8(__p0);
48046 return __ret;
48047}
48714#define vld4q_lane_u64(__p0, __p1, __p2) __extension__ ({ \
48715 uint64x2x4_t __ret; \
48716 uint64x2x4_t __s1 = __p1; \
48717 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 51); \
48718 __ret; \
48719})
4804848720#else
48049__ai int16_t vaddlvq_s8(int8x16_t __p0) {
48050 int16_t __ret;
48051 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
48052 __ret = (int16_t) __builtin_neon_vaddlvq_s8(__rev0);
48053 return __ret;
48054}
48721#define vld4q_lane_u64(__p0, __p1, __p2) __extension__ ({ \
48722 uint64x2x4_t __ret; \
48723 uint64x2x4_t __s1 = __p1; \
48724 uint64x2x4_t __rev1; \
48725 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
48726 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
48727 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
48728 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 1, 0); \
48729 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 51); \
48730 \
48731 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
48732 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
48733 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
48734 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 1, 0); \
48735 __ret; \
48736})
4805548737#endif
4805648738
4805748739#ifdef __LITTLE_ENDIAN__
48058__ai int64_t vaddlvq_s32(int32x4_t __p0) {
48059 int64_t __ret;
48060 __ret = (int64_t) __builtin_neon_vaddlvq_s32(__p0);
48061 return __ret;
48062}
48740#define vld4q_lane_s8(__p0, __p1, __p2) __extension__ ({ \
48741 int8x16x4_t __ret; \
48742 int8x16x4_t __s1 = __p1; \
48743 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 32); \
48744 __ret; \
48745})
4806348746#else
48064__ai int64_t vaddlvq_s32(int32x4_t __p0) {
48065 int64_t __ret;
48066 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
48067 __ret = (int64_t) __builtin_neon_vaddlvq_s32(__rev0);
48068 return __ret;
48069}
48747#define vld4q_lane_s8(__p0, __p1, __p2) __extension__ ({ \
48748 int8x16x4_t __ret; \
48749 int8x16x4_t __s1 = __p1; \
48750 int8x16x4_t __rev1; \
48751 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48752 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48753 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48754 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48755 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 32); \
48756 \
48757 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48758 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48759 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48760 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
48761 __ret; \
48762})
4807048763#endif
4807148764
4807248765#ifdef __LITTLE_ENDIAN__
48073__ai int32_t vaddlvq_s16(int16x8_t __p0) {
48074 int32_t __ret;
48075 __ret = (int32_t) __builtin_neon_vaddlvq_s16(__p0);
48076 return __ret;
48077}
48766#define vld4q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
48767 float64x2x4_t __ret; \
48768 float64x2x4_t __s1 = __p1; \
48769 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 42); \
48770 __ret; \
48771})
4807848772#else
48079__ai int32_t vaddlvq_s16(int16x8_t __p0) {
48080 int32_t __ret;
48081 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
48082 __ret = (int32_t) __builtin_neon_vaddlvq_s16(__rev0);
48083 return __ret;
48084}
48773#define vld4q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
48774 float64x2x4_t __ret; \
48775 float64x2x4_t __s1 = __p1; \
48776 float64x2x4_t __rev1; \
48777 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
48778 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
48779 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
48780 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 1, 0); \
48781 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 42); \
48782 \
48783 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
48784 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
48785 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
48786 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 1, 0); \
48787 __ret; \
48788})
4808548789#endif
4808648790
4808748791#ifdef __LITTLE_ENDIAN__
48088__ai uint16_t vaddlv_u8(uint8x8_t __p0) {
48089 uint16_t __ret;
48090 __ret = (uint16_t) __builtin_neon_vaddlv_u8(__p0);
48091 return __ret;
48092}
48792#define vld4q_lane_s64(__p0, __p1, __p2) __extension__ ({ \
48793 int64x2x4_t __ret; \
48794 int64x2x4_t __s1 = __p1; \
48795 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 35); \
48796 __ret; \
48797})
4809348798#else
48094__ai uint16_t vaddlv_u8(uint8x8_t __p0) {
48095 uint16_t __ret;
48096 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
48097 __ret = (uint16_t) __builtin_neon_vaddlv_u8(__rev0);
48098 return __ret;
48099}
48799#define vld4q_lane_s64(__p0, __p1, __p2) __extension__ ({ \
48800 int64x2x4_t __ret; \
48801 int64x2x4_t __s1 = __p1; \
48802 int64x2x4_t __rev1; \
48803 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
48804 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
48805 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
48806 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 1, 0); \
48807 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 35); \
48808 \
48809 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
48810 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
48811 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
48812 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 1, 0); \
48813 __ret; \
48814})
4810048815#endif
4810148816
48817#define vld4_lane_u64(__p0, __p1, __p2) __extension__ ({ \
48818 uint64x1x4_t __ret; \
48819 uint64x1x4_t __s1 = __p1; \
48820 __builtin_neon_vld4_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], __p2, 19); \
48821 __ret; \
48822})
48823#define vld4_lane_f64(__p0, __p1, __p2) __extension__ ({ \
48824 float64x1x4_t __ret; \
48825 float64x1x4_t __s1 = __p1; \
48826 __builtin_neon_vld4_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], __p2, 10); \
48827 __ret; \
48828})
48829#define vld4_lane_s64(__p0, __p1, __p2) __extension__ ({ \
48830 int64x1x4_t __ret; \
48831 int64x1x4_t __s1 = __p1; \
48832 __builtin_neon_vld4_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], __p2, 3); \
48833 __ret; \
48834})
48835#define vldrq_p128(__p0) __extension__ ({ \
48836 poly128_t __ret; \
48837 __ret = (poly128_t) __builtin_neon_vldrq_p128(__p0); \
48838 __ret; \
48839})
4810248840#ifdef __LITTLE_ENDIAN__
48103__ai uint64_t vaddlv_u32(uint32x2_t __p0) {
48104 uint64_t __ret;
48105 __ret = (uint64_t) __builtin_neon_vaddlv_u32(__p0);
48841__ai float64x2_t vmaxq_f64(float64x2_t __p0, float64x2_t __p1) {
48842 float64x2_t __ret;
48843 __ret = (float64x2_t) __builtin_neon_vmaxq_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
4810648844 return __ret;
4810748845}
4810848846#else
48109__ai uint64_t vaddlv_u32(uint32x2_t __p0) {
48110 uint64_t __ret;
48111 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
48112 __ret = (uint64_t) __builtin_neon_vaddlv_u32(__rev0);
48847__ai float64x2_t vmaxq_f64(float64x2_t __p0, float64x2_t __p1) {
48848 float64x2_t __ret;
48849 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
48850 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
48851 __ret = (float64x2_t) __builtin_neon_vmaxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
48852 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4811348853 return __ret;
4811448854}
4811548855#endif
4811648856
48117#ifdef __LITTLE_ENDIAN__
48118__ai uint32_t vaddlv_u16(uint16x4_t __p0) {
48119 uint32_t __ret;
48120 __ret = (uint32_t) __builtin_neon_vaddlv_u16(__p0);
48121 return __ret;
48122}
48123#else
48124__ai uint32_t vaddlv_u16(uint16x4_t __p0) {
48125 uint32_t __ret;
48126 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
48127 __ret = (uint32_t) __builtin_neon_vaddlv_u16(__rev0);
48857__ai float64x1_t vmax_f64(float64x1_t __p0, float64x1_t __p1) {
48858 float64x1_t __ret;
48859 __ret = (float64x1_t) __builtin_neon_vmax_v((int8x8_t)__p0, (int8x8_t)__p1, 10);
4812848860 return __ret;
4812948861}
48130#endif
48131
4813248862#ifdef __LITTLE_ENDIAN__
48133__ai int16_t vaddlv_s8(int8x8_t __p0) {
48134 int16_t __ret;
48135 __ret = (int16_t) __builtin_neon_vaddlv_s8(__p0);
48863__ai float64_t vmaxnmvq_f64(float64x2_t __p0) {
48864 float64_t __ret;
48865 __ret = (float64_t) __builtin_neon_vmaxnmvq_f64(__p0);
4813648866 return __ret;
4813748867}
4813848868#else
48139__ai int16_t vaddlv_s8(int8x8_t __p0) {
48140 int16_t __ret;
48141 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
48142 __ret = (int16_t) __builtin_neon_vaddlv_s8(__rev0);
48869__ai float64_t vmaxnmvq_f64(float64x2_t __p0) {
48870 float64_t __ret;
48871 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
48872 __ret = (float64_t) __builtin_neon_vmaxnmvq_f64(__rev0);
4814348873 return __ret;
4814448874}
4814548875#endif
4814648876
4814748877#ifdef __LITTLE_ENDIAN__
48148__ai int64_t vaddlv_s32(int32x2_t __p0) {
48149 int64_t __ret;
48150 __ret = (int64_t) __builtin_neon_vaddlv_s32(__p0);
48878__ai float32_t vmaxnmvq_f32(float32x4_t __p0) {
48879 float32_t __ret;
48880 __ret = (float32_t) __builtin_neon_vmaxnmvq_f32(__p0);
4815148881 return __ret;
4815248882}
4815348883#else
48154__ai int64_t vaddlv_s32(int32x2_t __p0) {
48155 int64_t __ret;
48156 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
48157 __ret = (int64_t) __builtin_neon_vaddlv_s32(__rev0);
48884__ai float32_t vmaxnmvq_f32(float32x4_t __p0) {
48885 float32_t __ret;
48886 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
48887 __ret = (float32_t) __builtin_neon_vmaxnmvq_f32(__rev0);
4815848888 return __ret;
4815948889}
4816048890#endif
4816148891
4816248892#ifdef __LITTLE_ENDIAN__
48163__ai int32_t vaddlv_s16(int16x4_t __p0) {
48164 int32_t __ret;
48165 __ret = (int32_t) __builtin_neon_vaddlv_s16(__p0);
48893__ai float32_t vmaxnmv_f32(float32x2_t __p0) {
48894 float32_t __ret;
48895 __ret = (float32_t) __builtin_neon_vmaxnmv_f32(__p0);
4816648896 return __ret;
4816748897}
4816848898#else
48169__ai int32_t vaddlv_s16(int16x4_t __p0) {
48170 int32_t __ret;
48171 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
48172 __ret = (int32_t) __builtin_neon_vaddlv_s16(__rev0);
48899__ai float32_t vmaxnmv_f32(float32x2_t __p0) {
48900 float32_t __ret;
48901 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
48902 __ret = (float32_t) __builtin_neon_vmaxnmv_f32(__rev0);
4817348903 return __ret;
4817448904}
4817548905#endif
4817648906
4817748907#ifdef __LITTLE_ENDIAN__
48178__ai uint8_t vaddvq_u8(uint8x16_t __p0) {
48908__ai uint8_t vmaxvq_u8(uint8x16_t __p0) {
4817948909 uint8_t __ret;
48180 __ret = (uint8_t) __builtin_neon_vaddvq_u8(__p0);
48910 __ret = (uint8_t) __builtin_neon_vmaxvq_u8(__p0);
4818148911 return __ret;
4818248912}
4818348913#else
48184__ai uint8_t vaddvq_u8(uint8x16_t __p0) {
48914__ai uint8_t vmaxvq_u8(uint8x16_t __p0) {
4818548915 uint8_t __ret;
4818648916 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
48187 __ret = (uint8_t) __builtin_neon_vaddvq_u8(__rev0);
48917 __ret = (uint8_t) __builtin_neon_vmaxvq_u8(__rev0);
4818848918 return __ret;
4818948919}
4819048920#endif
4819148921
4819248922#ifdef __LITTLE_ENDIAN__
48193__ai uint32_t vaddvq_u32(uint32x4_t __p0) {
48923__ai uint32_t vmaxvq_u32(uint32x4_t __p0) {
4819448924 uint32_t __ret;
48195 __ret = (uint32_t) __builtin_neon_vaddvq_u32(__p0);
48925 __ret = (uint32_t) __builtin_neon_vmaxvq_u32(__p0);
4819648926 return __ret;
4819748927}
4819848928#else
48199__ai uint32_t vaddvq_u32(uint32x4_t __p0) {
48929__ai uint32_t vmaxvq_u32(uint32x4_t __p0) {
4820048930 uint32_t __ret;
4820148931 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
48202 __ret = (uint32_t) __builtin_neon_vaddvq_u32(__rev0);
48203 return __ret;
48204}
48205#endif
48206
48207#ifdef __LITTLE_ENDIAN__
48208__ai uint64_t vaddvq_u64(uint64x2_t __p0) {
48209 uint64_t __ret;
48210 __ret = (uint64_t) __builtin_neon_vaddvq_u64(__p0);
48211 return __ret;
48212}
48213#else
48214__ai uint64_t vaddvq_u64(uint64x2_t __p0) {
48215 uint64_t __ret;
48216 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
48217 __ret = (uint64_t) __builtin_neon_vaddvq_u64(__rev0);
48932 __ret = (uint32_t) __builtin_neon_vmaxvq_u32(__rev0);
4821848933 return __ret;
4821948934}
4822048935#endif
4822148936
4822248937#ifdef __LITTLE_ENDIAN__
48223__ai uint16_t vaddvq_u16(uint16x8_t __p0) {
48938__ai uint16_t vmaxvq_u16(uint16x8_t __p0) {
4822448939 uint16_t __ret;
48225 __ret = (uint16_t) __builtin_neon_vaddvq_u16(__p0);
48940 __ret = (uint16_t) __builtin_neon_vmaxvq_u16(__p0);
4822648941 return __ret;
4822748942}
4822848943#else
48229__ai uint16_t vaddvq_u16(uint16x8_t __p0) {
48944__ai uint16_t vmaxvq_u16(uint16x8_t __p0) {
4823048945 uint16_t __ret;
4823148946 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
48232 __ret = (uint16_t) __builtin_neon_vaddvq_u16(__rev0);
48947 __ret = (uint16_t) __builtin_neon_vmaxvq_u16(__rev0);
4823348948 return __ret;
4823448949}
4823548950#endif
4823648951
4823748952#ifdef __LITTLE_ENDIAN__
48238__ai int8_t vaddvq_s8(int8x16_t __p0) {
48953__ai int8_t vmaxvq_s8(int8x16_t __p0) {
4823948954 int8_t __ret;
48240 __ret = (int8_t) __builtin_neon_vaddvq_s8(__p0);
48955 __ret = (int8_t) __builtin_neon_vmaxvq_s8(__p0);
4824148956 return __ret;
4824248957}
4824348958#else
48244__ai int8_t vaddvq_s8(int8x16_t __p0) {
48959__ai int8_t vmaxvq_s8(int8x16_t __p0) {
4824548960 int8_t __ret;
4824648961 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
48247 __ret = (int8_t) __builtin_neon_vaddvq_s8(__rev0);
48962 __ret = (int8_t) __builtin_neon_vmaxvq_s8(__rev0);
4824848963 return __ret;
4824948964}
4825048965#endif
4825148966
4825248967#ifdef __LITTLE_ENDIAN__
48253__ai float64_t vaddvq_f64(float64x2_t __p0) {
48968__ai float64_t vmaxvq_f64(float64x2_t __p0) {
4825448969 float64_t __ret;
48255 __ret = (float64_t) __builtin_neon_vaddvq_f64(__p0);
48970 __ret = (float64_t) __builtin_neon_vmaxvq_f64(__p0);
4825648971 return __ret;
4825748972}
4825848973#else
48259__ai float64_t vaddvq_f64(float64x2_t __p0) {
48974__ai float64_t vmaxvq_f64(float64x2_t __p0) {
4826048975 float64_t __ret;
4826148976 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
48262 __ret = (float64_t) __builtin_neon_vaddvq_f64(__rev0);
48977 __ret = (float64_t) __builtin_neon_vmaxvq_f64(__rev0);
4826348978 return __ret;
4826448979}
4826548980#endif
4826648981
4826748982#ifdef __LITTLE_ENDIAN__
48268__ai float32_t vaddvq_f32(float32x4_t __p0) {
48983__ai float32_t vmaxvq_f32(float32x4_t __p0) {
4826948984 float32_t __ret;
48270 __ret = (float32_t) __builtin_neon_vaddvq_f32(__p0);
48985 __ret = (float32_t) __builtin_neon_vmaxvq_f32(__p0);
4827148986 return __ret;
4827248987}
4827348988#else
48274__ai float32_t vaddvq_f32(float32x4_t __p0) {
48989__ai float32_t vmaxvq_f32(float32x4_t __p0) {
4827548990 float32_t __ret;
4827648991 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
48277 __ret = (float32_t) __builtin_neon_vaddvq_f32(__rev0);
48992 __ret = (float32_t) __builtin_neon_vmaxvq_f32(__rev0);
4827848993 return __ret;
4827948994}
4828048995#endif
4828148996
4828248997#ifdef __LITTLE_ENDIAN__
48283__ai int32_t vaddvq_s32(int32x4_t __p0) {
48998__ai int32_t vmaxvq_s32(int32x4_t __p0) {
4828448999 int32_t __ret;
48285 __ret = (int32_t) __builtin_neon_vaddvq_s32(__p0);
49000 __ret = (int32_t) __builtin_neon_vmaxvq_s32(__p0);
4828649001 return __ret;
4828749002}
4828849003#else
48289__ai int32_t vaddvq_s32(int32x4_t __p0) {
49004__ai int32_t vmaxvq_s32(int32x4_t __p0) {
4829049005 int32_t __ret;
4829149006 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
48292 __ret = (int32_t) __builtin_neon_vaddvq_s32(__rev0);
48293 return __ret;
48294}
48295#endif
48296
48297#ifdef __LITTLE_ENDIAN__
48298__ai int64_t vaddvq_s64(int64x2_t __p0) {
48299 int64_t __ret;
48300 __ret = (int64_t) __builtin_neon_vaddvq_s64(__p0);
48301 return __ret;
48302}
48303#else
48304__ai int64_t vaddvq_s64(int64x2_t __p0) {
48305 int64_t __ret;
48306 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
48307 __ret = (int64_t) __builtin_neon_vaddvq_s64(__rev0);
49007 __ret = (int32_t) __builtin_neon_vmaxvq_s32(__rev0);
4830849008 return __ret;
4830949009}
4831049010#endif
4831149011
4831249012#ifdef __LITTLE_ENDIAN__
48313__ai int16_t vaddvq_s16(int16x8_t __p0) {
49013__ai int16_t vmaxvq_s16(int16x8_t __p0) {
4831449014 int16_t __ret;
48315 __ret = (int16_t) __builtin_neon_vaddvq_s16(__p0);
49015 __ret = (int16_t) __builtin_neon_vmaxvq_s16(__p0);
4831649016 return __ret;
4831749017}
4831849018#else
48319__ai int16_t vaddvq_s16(int16x8_t __p0) {
49019__ai int16_t vmaxvq_s16(int16x8_t __p0) {
4832049020 int16_t __ret;
4832149021 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
48322 __ret = (int16_t) __builtin_neon_vaddvq_s16(__rev0);
49022 __ret = (int16_t) __builtin_neon_vmaxvq_s16(__rev0);
4832349023 return __ret;
4832449024}
4832549025#endif
4832649026
4832749027#ifdef __LITTLE_ENDIAN__
48328__ai uint8_t vaddv_u8(uint8x8_t __p0) {
49028__ai uint8_t vmaxv_u8(uint8x8_t __p0) {
4832949029 uint8_t __ret;
48330 __ret = (uint8_t) __builtin_neon_vaddv_u8(__p0);
49030 __ret = (uint8_t) __builtin_neon_vmaxv_u8(__p0);
4833149031 return __ret;
4833249032}
4833349033#else
48334__ai uint8_t vaddv_u8(uint8x8_t __p0) {
49034__ai uint8_t vmaxv_u8(uint8x8_t __p0) {
4833549035 uint8_t __ret;
4833649036 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
48337 __ret = (uint8_t) __builtin_neon_vaddv_u8(__rev0);
49037 __ret = (uint8_t) __builtin_neon_vmaxv_u8(__rev0);
4833849038 return __ret;
4833949039}
4834049040#endif
4834149041
4834249042#ifdef __LITTLE_ENDIAN__
48343__ai uint32_t vaddv_u32(uint32x2_t __p0) {
49043__ai uint32_t vmaxv_u32(uint32x2_t __p0) {
4834449044 uint32_t __ret;
48345 __ret = (uint32_t) __builtin_neon_vaddv_u32(__p0);
49045 __ret = (uint32_t) __builtin_neon_vmaxv_u32(__p0);
4834649046 return __ret;
4834749047}
4834849048#else
48349__ai uint32_t vaddv_u32(uint32x2_t __p0) {
49049__ai uint32_t vmaxv_u32(uint32x2_t __p0) {
4835049050 uint32_t __ret;
4835149051 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
48352 __ret = (uint32_t) __builtin_neon_vaddv_u32(__rev0);
49052 __ret = (uint32_t) __builtin_neon_vmaxv_u32(__rev0);
4835349053 return __ret;
4835449054}
4835549055#endif
4835649056
4835749057#ifdef __LITTLE_ENDIAN__
48358__ai uint16_t vaddv_u16(uint16x4_t __p0) {
49058__ai uint16_t vmaxv_u16(uint16x4_t __p0) {
4835949059 uint16_t __ret;
48360 __ret = (uint16_t) __builtin_neon_vaddv_u16(__p0);
49060 __ret = (uint16_t) __builtin_neon_vmaxv_u16(__p0);
4836149061 return __ret;
4836249062}
4836349063#else
48364__ai uint16_t vaddv_u16(uint16x4_t __p0) {
49064__ai uint16_t vmaxv_u16(uint16x4_t __p0) {
4836549065 uint16_t __ret;
4836649066 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
48367 __ret = (uint16_t) __builtin_neon_vaddv_u16(__rev0);
49067 __ret = (uint16_t) __builtin_neon_vmaxv_u16(__rev0);
4836849068 return __ret;
4836949069}
4837049070#endif
4837149071
4837249072#ifdef __LITTLE_ENDIAN__
48373__ai int8_t vaddv_s8(int8x8_t __p0) {
49073__ai int8_t vmaxv_s8(int8x8_t __p0) {
4837449074 int8_t __ret;
48375 __ret = (int8_t) __builtin_neon_vaddv_s8(__p0);
49075 __ret = (int8_t) __builtin_neon_vmaxv_s8(__p0);
4837649076 return __ret;
4837749077}
4837849078#else
48379__ai int8_t vaddv_s8(int8x8_t __p0) {
49079__ai int8_t vmaxv_s8(int8x8_t __p0) {
4838049080 int8_t __ret;
4838149081 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
48382 __ret = (int8_t) __builtin_neon_vaddv_s8(__rev0);
49082 __ret = (int8_t) __builtin_neon_vmaxv_s8(__rev0);
4838349083 return __ret;
4838449084}
4838549085#endif
4838649086
4838749087#ifdef __LITTLE_ENDIAN__
48388__ai float32_t vaddv_f32(float32x2_t __p0) {
49088__ai float32_t vmaxv_f32(float32x2_t __p0) {
4838949089 float32_t __ret;
48390 __ret = (float32_t) __builtin_neon_vaddv_f32(__p0);
49090 __ret = (float32_t) __builtin_neon_vmaxv_f32(__p0);
4839149091 return __ret;
4839249092}
4839349093#else
48394__ai float32_t vaddv_f32(float32x2_t __p0) {
49094__ai float32_t vmaxv_f32(float32x2_t __p0) {
4839549095 float32_t __ret;
4839649096 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
48397 __ret = (float32_t) __builtin_neon_vaddv_f32(__rev0);
49097 __ret = (float32_t) __builtin_neon_vmaxv_f32(__rev0);
4839849098 return __ret;
4839949099}
4840049100#endif
4840149101
4840249102#ifdef __LITTLE_ENDIAN__
48403__ai int32_t vaddv_s32(int32x2_t __p0) {
49103__ai int32_t vmaxv_s32(int32x2_t __p0) {
4840449104 int32_t __ret;
48405 __ret = (int32_t) __builtin_neon_vaddv_s32(__p0);
49105 __ret = (int32_t) __builtin_neon_vmaxv_s32(__p0);
4840649106 return __ret;
4840749107}
4840849108#else
48409__ai int32_t vaddv_s32(int32x2_t __p0) {
49109__ai int32_t vmaxv_s32(int32x2_t __p0) {
4841049110 int32_t __ret;
4841149111 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
48412 __ret = (int32_t) __builtin_neon_vaddv_s32(__rev0);
49112 __ret = (int32_t) __builtin_neon_vmaxv_s32(__rev0);
4841349113 return __ret;
4841449114}
4841549115#endif
4841649116
4841749117#ifdef __LITTLE_ENDIAN__
48418__ai int16_t vaddv_s16(int16x4_t __p0) {
49118__ai int16_t vmaxv_s16(int16x4_t __p0) {
4841949119 int16_t __ret;
48420 __ret = (int16_t) __builtin_neon_vaddv_s16(__p0);
49120 __ret = (int16_t) __builtin_neon_vmaxv_s16(__p0);
4842149121 return __ret;
4842249122}
4842349123#else
48424__ai int16_t vaddv_s16(int16x4_t __p0) {
49124__ai int16_t vmaxv_s16(int16x4_t __p0) {
4842549125 int16_t __ret;
4842649126 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
48427 __ret = (int16_t) __builtin_neon_vaddv_s16(__rev0);
48428 return __ret;
48429}
48430#endif
48431
48432__ai poly64x1_t vbsl_p64(uint64x1_t __p0, poly64x1_t __p1, poly64x1_t __p2) {
48433 poly64x1_t __ret;
48434 __ret = (poly64x1_t) __builtin_neon_vbsl_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 6);
48435 return __ret;
48436}
48437#ifdef __LITTLE_ENDIAN__
48438__ai poly64x2_t vbslq_p64(uint64x2_t __p0, poly64x2_t __p1, poly64x2_t __p2) {
48439 poly64x2_t __ret;
48440 __ret = (poly64x2_t) __builtin_neon_vbslq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 38);
48441 return __ret;
48442}
48443#else
48444__ai poly64x2_t vbslq_p64(uint64x2_t __p0, poly64x2_t __p1, poly64x2_t __p2) {
48445 poly64x2_t __ret;
48446 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
48447 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
48448 poly64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
48449 __ret = (poly64x2_t) __builtin_neon_vbslq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 38);
48450 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
49127 __ret = (int16_t) __builtin_neon_vmaxv_s16(__rev0);
4845149128 return __ret;
4845249129}
4845349130#endif
4845449131
4845549132#ifdef __LITTLE_ENDIAN__
48456__ai float64x2_t vbslq_f64(uint64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
48457 float64x2_t __ret;
48458 __ret = (float64x2_t) __builtin_neon_vbslq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 42);
48459 return __ret;
48460}
48461#else
48462__ai float64x2_t vbslq_f64(uint64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
49133__ai float64x2_t vminq_f64(float64x2_t __p0, float64x2_t __p1) {
4846349134 float64x2_t __ret;
48464 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
48465 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
48466 float64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
48467 __ret = (float64x2_t) __builtin_neon_vbslq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 42);
48468 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
48469 return __ret;
48470}
48471#endif
48472
48473__ai float64x1_t vbsl_f64(uint64x1_t __p0, float64x1_t __p1, float64x1_t __p2) {
48474 float64x1_t __ret;
48475 __ret = (float64x1_t) __builtin_neon_vbsl_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 10);
48476 return __ret;
48477}
48478#ifdef __LITTLE_ENDIAN__
48479__ai uint64x2_t vcageq_f64(float64x2_t __p0, float64x2_t __p1) {
48480 uint64x2_t __ret;
48481 __ret = (uint64x2_t) __builtin_neon_vcageq_v((int8x16_t)__p0, (int8x16_t)__p1, 51);
48482 return __ret;
48483}
48484#else
48485__ai uint64x2_t vcageq_f64(float64x2_t __p0, float64x2_t __p1) {
48486 uint64x2_t __ret;
48487 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
48488 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
48489 __ret = (uint64x2_t) __builtin_neon_vcageq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 51);
48490 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
48491 return __ret;
48492}
48493#endif
48494
48495__ai uint64x1_t vcage_f64(float64x1_t __p0, float64x1_t __p1) {
48496 uint64x1_t __ret;
48497 __ret = (uint64x1_t) __builtin_neon_vcage_v((int8x8_t)__p0, (int8x8_t)__p1, 19);
48498 return __ret;
48499}
48500__ai uint64_t vcaged_f64(float64_t __p0, float64_t __p1) {
48501 uint64_t __ret;
48502 __ret = (uint64_t) __builtin_neon_vcaged_f64(__p0, __p1);
48503 return __ret;
48504}
48505__ai uint32_t vcages_f32(float32_t __p0, float32_t __p1) {
48506 uint32_t __ret;
48507 __ret = (uint32_t) __builtin_neon_vcages_f32(__p0, __p1);
48508 return __ret;
48509}
48510#ifdef __LITTLE_ENDIAN__
48511__ai uint64x2_t vcagtq_f64(float64x2_t __p0, float64x2_t __p1) {
48512 uint64x2_t __ret;
48513 __ret = (uint64x2_t) __builtin_neon_vcagtq_v((int8x16_t)__p0, (int8x16_t)__p1, 51);
48514 return __ret;
48515}
48516#else
48517__ai uint64x2_t vcagtq_f64(float64x2_t __p0, float64x2_t __p1) {
48518 uint64x2_t __ret;
48519 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
48520 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
48521 __ret = (uint64x2_t) __builtin_neon_vcagtq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 51);
48522 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
48523 return __ret;
48524}
48525#endif
48526
48527__ai uint64x1_t vcagt_f64(float64x1_t __p0, float64x1_t __p1) {
48528 uint64x1_t __ret;
48529 __ret = (uint64x1_t) __builtin_neon_vcagt_v((int8x8_t)__p0, (int8x8_t)__p1, 19);
48530 return __ret;
48531}
48532__ai uint64_t vcagtd_f64(float64_t __p0, float64_t __p1) {
48533 uint64_t __ret;
48534 __ret = (uint64_t) __builtin_neon_vcagtd_f64(__p0, __p1);
48535 return __ret;
48536}
48537__ai uint32_t vcagts_f32(float32_t __p0, float32_t __p1) {
48538 uint32_t __ret;
48539 __ret = (uint32_t) __builtin_neon_vcagts_f32(__p0, __p1);
48540 return __ret;
48541}
48542#ifdef __LITTLE_ENDIAN__
48543__ai uint64x2_t vcaleq_f64(float64x2_t __p0, float64x2_t __p1) {
48544 uint64x2_t __ret;
48545 __ret = (uint64x2_t) __builtin_neon_vcaleq_v((int8x16_t)__p0, (int8x16_t)__p1, 51);
48546 return __ret;
48547}
48548#else
48549__ai uint64x2_t vcaleq_f64(float64x2_t __p0, float64x2_t __p1) {
48550 uint64x2_t __ret;
48551 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
48552 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
48553 __ret = (uint64x2_t) __builtin_neon_vcaleq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 51);
48554 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
48555 return __ret;
48556}
48557#endif
48558
48559__ai uint64x1_t vcale_f64(float64x1_t __p0, float64x1_t __p1) {
48560 uint64x1_t __ret;
48561 __ret = (uint64x1_t) __builtin_neon_vcale_v((int8x8_t)__p0, (int8x8_t)__p1, 19);
48562 return __ret;
48563}
48564__ai uint64_t vcaled_f64(float64_t __p0, float64_t __p1) {
48565 uint64_t __ret;
48566 __ret = (uint64_t) __builtin_neon_vcaled_f64(__p0, __p1);
48567 return __ret;
48568}
48569__ai uint32_t vcales_f32(float32_t __p0, float32_t __p1) {
48570 uint32_t __ret;
48571 __ret = (uint32_t) __builtin_neon_vcales_f32(__p0, __p1);
48572 return __ret;
48573}
48574#ifdef __LITTLE_ENDIAN__
48575__ai uint64x2_t vcaltq_f64(float64x2_t __p0, float64x2_t __p1) {
48576 uint64x2_t __ret;
48577 __ret = (uint64x2_t) __builtin_neon_vcaltq_v((int8x16_t)__p0, (int8x16_t)__p1, 51);
48578 return __ret;
48579}
48580#else
48581__ai uint64x2_t vcaltq_f64(float64x2_t __p0, float64x2_t __p1) {
48582 uint64x2_t __ret;
48583 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
48584 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
48585 __ret = (uint64x2_t) __builtin_neon_vcaltq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 51);
48586 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
48587 return __ret;
48588}
48589#endif
48590
48591__ai uint64x1_t vcalt_f64(float64x1_t __p0, float64x1_t __p1) {
48592 uint64x1_t __ret;
48593 __ret = (uint64x1_t) __builtin_neon_vcalt_v((int8x8_t)__p0, (int8x8_t)__p1, 19);
48594 return __ret;
48595}
48596__ai uint64_t vcaltd_f64(float64_t __p0, float64_t __p1) {
48597 uint64_t __ret;
48598 __ret = (uint64_t) __builtin_neon_vcaltd_f64(__p0, __p1);
48599 return __ret;
48600}
48601__ai uint32_t vcalts_f32(float32_t __p0, float32_t __p1) {
48602 uint32_t __ret;
48603 __ret = (uint32_t) __builtin_neon_vcalts_f32(__p0, __p1);
48604 return __ret;
48605}
48606__ai uint64x1_t vceq_p64(poly64x1_t __p0, poly64x1_t __p1) {
48607 uint64x1_t __ret;
48608 __ret = (uint64x1_t)(__p0 == __p1);
48609 return __ret;
48610}
48611#ifdef __LITTLE_ENDIAN__
48612__ai uint64x2_t vceqq_p64(poly64x2_t __p0, poly64x2_t __p1) {
48613 uint64x2_t __ret;
48614 __ret = (uint64x2_t)(__p0 == __p1);
48615 return __ret;
48616}
48617#else
48618__ai uint64x2_t vceqq_p64(poly64x2_t __p0, poly64x2_t __p1) {
48619 uint64x2_t __ret;
48620 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
48621 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
48622 __ret = (uint64x2_t)(__rev0 == __rev1);
48623 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
48624 return __ret;
48625}
48626#endif
48627
48628#ifdef __LITTLE_ENDIAN__
48629__ai uint64x2_t vceqq_u64(uint64x2_t __p0, uint64x2_t __p1) {
48630 uint64x2_t __ret;
48631 __ret = (uint64x2_t)(__p0 == __p1);
48632 return __ret;
48633}
48634#else
48635__ai uint64x2_t vceqq_u64(uint64x2_t __p0, uint64x2_t __p1) {
48636 uint64x2_t __ret;
48637 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
48638 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
48639 __ret = (uint64x2_t)(__rev0 == __rev1);
48640 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
48641 return __ret;
48642}
48643#endif
48644
48645#ifdef __LITTLE_ENDIAN__
48646__ai uint64x2_t vceqq_f64(float64x2_t __p0, float64x2_t __p1) {
48647 uint64x2_t __ret;
48648 __ret = (uint64x2_t)(__p0 == __p1);
48649 return __ret;
48650}
48651#else
48652__ai uint64x2_t vceqq_f64(float64x2_t __p0, float64x2_t __p1) {
48653 uint64x2_t __ret;
48654 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
48655 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
48656 __ret = (uint64x2_t)(__rev0 == __rev1);
48657 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
48658 return __ret;
48659}
48660#endif
48661
48662#ifdef __LITTLE_ENDIAN__
48663__ai uint64x2_t vceqq_s64(int64x2_t __p0, int64x2_t __p1) {
48664 uint64x2_t __ret;
48665 __ret = (uint64x2_t)(__p0 == __p1);
48666 return __ret;
48667}
48668#else
48669__ai uint64x2_t vceqq_s64(int64x2_t __p0, int64x2_t __p1) {
48670 uint64x2_t __ret;
48671 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
48672 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
48673 __ret = (uint64x2_t)(__rev0 == __rev1);
48674 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
48675 return __ret;
48676}
48677#endif
48678
48679__ai uint64x1_t vceq_u64(uint64x1_t __p0, uint64x1_t __p1) {
48680 uint64x1_t __ret;
48681 __ret = (uint64x1_t)(__p0 == __p1);
48682 return __ret;
48683}
48684__ai uint64x1_t vceq_f64(float64x1_t __p0, float64x1_t __p1) {
48685 uint64x1_t __ret;
48686 __ret = (uint64x1_t)(__p0 == __p1);
48687 return __ret;
48688}
48689__ai uint64x1_t vceq_s64(int64x1_t __p0, int64x1_t __p1) {
48690 uint64x1_t __ret;
48691 __ret = (uint64x1_t)(__p0 == __p1);
48692 return __ret;
48693}
48694__ai uint64_t vceqd_u64(uint64_t __p0, uint64_t __p1) {
48695 uint64_t __ret;
48696 __ret = (uint64_t) __builtin_neon_vceqd_u64(__p0, __p1);
48697 return __ret;
48698}
48699__ai uint64_t vceqd_s64(int64_t __p0, int64_t __p1) {
48700 uint64_t __ret;
48701 __ret = (uint64_t) __builtin_neon_vceqd_s64(__p0, __p1);
48702 return __ret;
48703}
48704__ai uint64_t vceqd_f64(float64_t __p0, float64_t __p1) {
48705 uint64_t __ret;
48706 __ret = (uint64_t) __builtin_neon_vceqd_f64(__p0, __p1);
48707 return __ret;
48708}
48709__ai uint32_t vceqs_f32(float32_t __p0, float32_t __p1) {
48710 uint32_t __ret;
48711 __ret = (uint32_t) __builtin_neon_vceqs_f32(__p0, __p1);
48712 return __ret;
48713}
48714#ifdef __LITTLE_ENDIAN__
48715__ai uint8x8_t vceqz_p8(poly8x8_t __p0) {
48716 uint8x8_t __ret;
48717 __ret = (uint8x8_t) __builtin_neon_vceqz_v((int8x8_t)__p0, 16);
49135 __ret = (float64x2_t) __builtin_neon_vminq_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
4871849136 return __ret;
48719}
48720#else
48721__ai uint8x8_t vceqz_p8(poly8x8_t __p0) {
48722 uint8x8_t __ret;
48723 poly8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
48724 __ret = (uint8x8_t) __builtin_neon_vceqz_v((int8x8_t)__rev0, 16);
48725 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
49137}
49138#else
49139__ai float64x2_t vminq_f64(float64x2_t __p0, float64x2_t __p1) {
49140 float64x2_t __ret;
49141 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49142 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
49143 __ret = (float64x2_t) __builtin_neon_vminq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
49144 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4872649145 return __ret;
4872749146}
4872849147#endif
4872949148
48730__ai uint64x1_t vceqz_p64(poly64x1_t __p0) {
48731 uint64x1_t __ret;
48732 __ret = (uint64x1_t) __builtin_neon_vceqz_v((int8x8_t)__p0, 19);
49149__ai float64x1_t vmin_f64(float64x1_t __p0, float64x1_t __p1) {
49150 float64x1_t __ret;
49151 __ret = (float64x1_t) __builtin_neon_vmin_v((int8x8_t)__p0, (int8x8_t)__p1, 10);
4873349152 return __ret;
4873449153}
4873549154#ifdef __LITTLE_ENDIAN__
48736__ai uint8x16_t vceqzq_p8(poly8x16_t __p0) {
48737 uint8x16_t __ret;
48738 __ret = (uint8x16_t) __builtin_neon_vceqzq_v((int8x16_t)__p0, 48);
49155__ai float64_t vminnmvq_f64(float64x2_t __p0) {
49156 float64_t __ret;
49157 __ret = (float64_t) __builtin_neon_vminnmvq_f64(__p0);
4873949158 return __ret;
4874049159}
4874149160#else
48742__ai uint8x16_t vceqzq_p8(poly8x16_t __p0) {
48743 uint8x16_t __ret;
48744 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
48745 __ret = (uint8x16_t) __builtin_neon_vceqzq_v((int8x16_t)__rev0, 48);
48746 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
49161__ai float64_t vminnmvq_f64(float64x2_t __p0) {
49162 float64_t __ret;
49163 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49164 __ret = (float64_t) __builtin_neon_vminnmvq_f64(__rev0);
4874749165 return __ret;
4874849166}
4874949167#endif
4875049168
4875149169#ifdef __LITTLE_ENDIAN__
48752__ai uint64x2_t vceqzq_p64(poly64x2_t __p0) {
48753 uint64x2_t __ret;
48754 __ret = (uint64x2_t) __builtin_neon_vceqzq_v((int8x16_t)__p0, 51);
49170__ai float32_t vminnmvq_f32(float32x4_t __p0) {
49171 float32_t __ret;
49172 __ret = (float32_t) __builtin_neon_vminnmvq_f32(__p0);
4875549173 return __ret;
4875649174}
4875749175#else
48758__ai uint64x2_t vceqzq_p64(poly64x2_t __p0) {
48759 uint64x2_t __ret;
48760 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
48761 __ret = (uint64x2_t) __builtin_neon_vceqzq_v((int8x16_t)__rev0, 51);
48762 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
49176__ai float32_t vminnmvq_f32(float32x4_t __p0) {
49177 float32_t __ret;
49178 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
49179 __ret = (float32_t) __builtin_neon_vminnmvq_f32(__rev0);
4876349180 return __ret;
4876449181}
4876549182#endif
4876649183
4876749184#ifdef __LITTLE_ENDIAN__
48768__ai uint8x16_t vceqzq_u8(uint8x16_t __p0) {
48769 uint8x16_t __ret;
48770 __ret = (uint8x16_t) __builtin_neon_vceqzq_v((int8x16_t)__p0, 48);
49185__ai float32_t vminnmv_f32(float32x2_t __p0) {
49186 float32_t __ret;
49187 __ret = (float32_t) __builtin_neon_vminnmv_f32(__p0);
4877149188 return __ret;
4877249189}
4877349190#else
48774__ai uint8x16_t vceqzq_u8(uint8x16_t __p0) {
48775 uint8x16_t __ret;
48776 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
48777 __ret = (uint8x16_t) __builtin_neon_vceqzq_v((int8x16_t)__rev0, 48);
48778 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
49191__ai float32_t vminnmv_f32(float32x2_t __p0) {
49192 float32_t __ret;
49193 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49194 __ret = (float32_t) __builtin_neon_vminnmv_f32(__rev0);
4877949195 return __ret;
4878049196}
4878149197#endif
4878249198
4878349199#ifdef __LITTLE_ENDIAN__
48784__ai uint32x4_t vceqzq_u32(uint32x4_t __p0) {
48785 uint32x4_t __ret;
48786 __ret = (uint32x4_t) __builtin_neon_vceqzq_v((int8x16_t)__p0, 50);
49200__ai uint8_t vminvq_u8(uint8x16_t __p0) {
49201 uint8_t __ret;
49202 __ret = (uint8_t) __builtin_neon_vminvq_u8(__p0);
4878749203 return __ret;
4878849204}
4878949205#else
48790__ai uint32x4_t vceqzq_u32(uint32x4_t __p0) {
48791 uint32x4_t __ret;
48792 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
48793 __ret = (uint32x4_t) __builtin_neon_vceqzq_v((int8x16_t)__rev0, 50);
48794 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
49206__ai uint8_t vminvq_u8(uint8x16_t __p0) {
49207 uint8_t __ret;
49208 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
49209 __ret = (uint8_t) __builtin_neon_vminvq_u8(__rev0);
4879549210 return __ret;
4879649211}
4879749212#endif
4879849213
4879949214#ifdef __LITTLE_ENDIAN__
48800__ai uint64x2_t vceqzq_u64(uint64x2_t __p0) {
48801 uint64x2_t __ret;
48802 __ret = (uint64x2_t) __builtin_neon_vceqzq_v((int8x16_t)__p0, 51);
49215__ai uint32_t vminvq_u32(uint32x4_t __p0) {
49216 uint32_t __ret;
49217 __ret = (uint32_t) __builtin_neon_vminvq_u32(__p0);
4880349218 return __ret;
4880449219}
4880549220#else
48806__ai uint64x2_t vceqzq_u64(uint64x2_t __p0) {
48807 uint64x2_t __ret;
48808 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
48809 __ret = (uint64x2_t) __builtin_neon_vceqzq_v((int8x16_t)__rev0, 51);
48810 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
49221__ai uint32_t vminvq_u32(uint32x4_t __p0) {
49222 uint32_t __ret;
49223 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
49224 __ret = (uint32_t) __builtin_neon_vminvq_u32(__rev0);
4881149225 return __ret;
4881249226}
4881349227#endif
4881449228
4881549229#ifdef __LITTLE_ENDIAN__
48816__ai uint16x8_t vceqzq_u16(uint16x8_t __p0) {
48817 uint16x8_t __ret;
48818 __ret = (uint16x8_t) __builtin_neon_vceqzq_v((int8x16_t)__p0, 49);
49230__ai uint16_t vminvq_u16(uint16x8_t __p0) {
49231 uint16_t __ret;
49232 __ret = (uint16_t) __builtin_neon_vminvq_u16(__p0);
4881949233 return __ret;
4882049234}
4882149235#else
48822__ai uint16x8_t vceqzq_u16(uint16x8_t __p0) {
48823 uint16x8_t __ret;
49236__ai uint16_t vminvq_u16(uint16x8_t __p0) {
49237 uint16_t __ret;
4882449238 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
48825 __ret = (uint16x8_t) __builtin_neon_vceqzq_v((int8x16_t)__rev0, 49);
48826 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
49239 __ret = (uint16_t) __builtin_neon_vminvq_u16(__rev0);
4882749240 return __ret;
4882849241}
4882949242#endif
4883049243
4883149244#ifdef __LITTLE_ENDIAN__
48832__ai uint8x16_t vceqzq_s8(int8x16_t __p0) {
48833 uint8x16_t __ret;
48834 __ret = (uint8x16_t) __builtin_neon_vceqzq_v((int8x16_t)__p0, 48);
49245__ai int8_t vminvq_s8(int8x16_t __p0) {
49246 int8_t __ret;
49247 __ret = (int8_t) __builtin_neon_vminvq_s8(__p0);
4883549248 return __ret;
4883649249}
4883749250#else
48838__ai uint8x16_t vceqzq_s8(int8x16_t __p0) {
48839 uint8x16_t __ret;
49251__ai int8_t vminvq_s8(int8x16_t __p0) {
49252 int8_t __ret;
4884049253 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
48841 __ret = (uint8x16_t) __builtin_neon_vceqzq_v((int8x16_t)__rev0, 48);
48842 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
49254 __ret = (int8_t) __builtin_neon_vminvq_s8(__rev0);
4884349255 return __ret;
4884449256}
4884549257#endif
4884649258
4884749259#ifdef __LITTLE_ENDIAN__
48848__ai uint64x2_t vceqzq_f64(float64x2_t __p0) {
48849 uint64x2_t __ret;
48850 __ret = (uint64x2_t) __builtin_neon_vceqzq_v((int8x16_t)__p0, 51);
49260__ai float64_t vminvq_f64(float64x2_t __p0) {
49261 float64_t __ret;
49262 __ret = (float64_t) __builtin_neon_vminvq_f64(__p0);
4885149263 return __ret;
4885249264}
4885349265#else
48854__ai uint64x2_t vceqzq_f64(float64x2_t __p0) {
48855 uint64x2_t __ret;
49266__ai float64_t vminvq_f64(float64x2_t __p0) {
49267 float64_t __ret;
4885649268 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
48857 __ret = (uint64x2_t) __builtin_neon_vceqzq_v((int8x16_t)__rev0, 51);
48858 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
49269 __ret = (float64_t) __builtin_neon_vminvq_f64(__rev0);
4885949270 return __ret;
4886049271}
4886149272#endif
4886249273
4886349274#ifdef __LITTLE_ENDIAN__
48864__ai uint32x4_t vceqzq_f32(float32x4_t __p0) {
48865 uint32x4_t __ret;
48866 __ret = (uint32x4_t) __builtin_neon_vceqzq_v((int8x16_t)__p0, 50);
49275__ai float32_t vminvq_f32(float32x4_t __p0) {
49276 float32_t __ret;
49277 __ret = (float32_t) __builtin_neon_vminvq_f32(__p0);
4886749278 return __ret;
4886849279}
4886949280#else
48870__ai uint32x4_t vceqzq_f32(float32x4_t __p0) {
48871 uint32x4_t __ret;
49281__ai float32_t vminvq_f32(float32x4_t __p0) {
49282 float32_t __ret;
4887249283 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
48873 __ret = (uint32x4_t) __builtin_neon_vceqzq_v((int8x16_t)__rev0, 50);
48874 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
49284 __ret = (float32_t) __builtin_neon_vminvq_f32(__rev0);
4887549285 return __ret;
4887649286}
4887749287#endif
4887849288
4887949289#ifdef __LITTLE_ENDIAN__
48880__ai uint32x4_t vceqzq_s32(int32x4_t __p0) {
48881 uint32x4_t __ret;
48882 __ret = (uint32x4_t) __builtin_neon_vceqzq_v((int8x16_t)__p0, 50);
49290__ai int32_t vminvq_s32(int32x4_t __p0) {
49291 int32_t __ret;
49292 __ret = (int32_t) __builtin_neon_vminvq_s32(__p0);
4888349293 return __ret;
4888449294}
4888549295#else
48886__ai uint32x4_t vceqzq_s32(int32x4_t __p0) {
48887 uint32x4_t __ret;
49296__ai int32_t vminvq_s32(int32x4_t __p0) {
49297 int32_t __ret;
4888849298 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
48889 __ret = (uint32x4_t) __builtin_neon_vceqzq_v((int8x16_t)__rev0, 50);
48890 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
48891 return __ret;
48892}
48893#endif
48894
48895#ifdef __LITTLE_ENDIAN__
48896__ai uint64x2_t vceqzq_s64(int64x2_t __p0) {
48897 uint64x2_t __ret;
48898 __ret = (uint64x2_t) __builtin_neon_vceqzq_v((int8x16_t)__p0, 51);
48899 return __ret;
48900}
48901#else
48902__ai uint64x2_t vceqzq_s64(int64x2_t __p0) {
48903 uint64x2_t __ret;
48904 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
48905 __ret = (uint64x2_t) __builtin_neon_vceqzq_v((int8x16_t)__rev0, 51);
48906 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
49299 __ret = (int32_t) __builtin_neon_vminvq_s32(__rev0);
4890749300 return __ret;
4890849301}
4890949302#endif
4891049303
4891149304#ifdef __LITTLE_ENDIAN__
48912__ai uint16x8_t vceqzq_s16(int16x8_t __p0) {
48913 uint16x8_t __ret;
48914 __ret = (uint16x8_t) __builtin_neon_vceqzq_v((int8x16_t)__p0, 49);
49305__ai int16_t vminvq_s16(int16x8_t __p0) {
49306 int16_t __ret;
49307 __ret = (int16_t) __builtin_neon_vminvq_s16(__p0);
4891549308 return __ret;
4891649309}
4891749310#else
48918__ai uint16x8_t vceqzq_s16(int16x8_t __p0) {
48919 uint16x8_t __ret;
49311__ai int16_t vminvq_s16(int16x8_t __p0) {
49312 int16_t __ret;
4892049313 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
48921 __ret = (uint16x8_t) __builtin_neon_vceqzq_v((int8x16_t)__rev0, 49);
48922 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
49314 __ret = (int16_t) __builtin_neon_vminvq_s16(__rev0);
4892349315 return __ret;
4892449316}
4892549317#endif
4892649318
4892749319#ifdef __LITTLE_ENDIAN__
48928__ai uint8x8_t vceqz_u8(uint8x8_t __p0) {
48929 uint8x8_t __ret;
48930 __ret = (uint8x8_t) __builtin_neon_vceqz_v((int8x8_t)__p0, 16);
49320__ai uint8_t vminv_u8(uint8x8_t __p0) {
49321 uint8_t __ret;
49322 __ret = (uint8_t) __builtin_neon_vminv_u8(__p0);
4893149323 return __ret;
4893249324}
4893349325#else
48934__ai uint8x8_t vceqz_u8(uint8x8_t __p0) {
48935 uint8x8_t __ret;
49326__ai uint8_t vminv_u8(uint8x8_t __p0) {
49327 uint8_t __ret;
4893649328 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
48937 __ret = (uint8x8_t) __builtin_neon_vceqz_v((int8x8_t)__rev0, 16);
48938 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
49329 __ret = (uint8_t) __builtin_neon_vminv_u8(__rev0);
4893949330 return __ret;
4894049331}
4894149332#endif
4894249333
4894349334#ifdef __LITTLE_ENDIAN__
48944__ai uint32x2_t vceqz_u32(uint32x2_t __p0) {
48945 uint32x2_t __ret;
48946 __ret = (uint32x2_t) __builtin_neon_vceqz_v((int8x8_t)__p0, 18);
49335__ai uint32_t vminv_u32(uint32x2_t __p0) {
49336 uint32_t __ret;
49337 __ret = (uint32_t) __builtin_neon_vminv_u32(__p0);
4894749338 return __ret;
4894849339}
4894949340#else
48950__ai uint32x2_t vceqz_u32(uint32x2_t __p0) {
48951 uint32x2_t __ret;
49341__ai uint32_t vminv_u32(uint32x2_t __p0) {
49342 uint32_t __ret;
4895249343 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
48953 __ret = (uint32x2_t) __builtin_neon_vceqz_v((int8x8_t)__rev0, 18);
48954 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
49344 __ret = (uint32_t) __builtin_neon_vminv_u32(__rev0);
4895549345 return __ret;
4895649346}
4895749347#endif
4895849348
48959__ai uint64x1_t vceqz_u64(uint64x1_t __p0) {
48960 uint64x1_t __ret;
48961 __ret = (uint64x1_t) __builtin_neon_vceqz_v((int8x8_t)__p0, 19);
48962 return __ret;
48963}
4896449349#ifdef __LITTLE_ENDIAN__
48965__ai uint16x4_t vceqz_u16(uint16x4_t __p0) {
48966 uint16x4_t __ret;
48967 __ret = (uint16x4_t) __builtin_neon_vceqz_v((int8x8_t)__p0, 17);
49350__ai uint16_t vminv_u16(uint16x4_t __p0) {
49351 uint16_t __ret;
49352 __ret = (uint16_t) __builtin_neon_vminv_u16(__p0);
4896849353 return __ret;
4896949354}
4897049355#else
48971__ai uint16x4_t vceqz_u16(uint16x4_t __p0) {
48972 uint16x4_t __ret;
49356__ai uint16_t vminv_u16(uint16x4_t __p0) {
49357 uint16_t __ret;
4897349358 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
48974 __ret = (uint16x4_t) __builtin_neon_vceqz_v((int8x8_t)__rev0, 17);
48975 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
49359 __ret = (uint16_t) __builtin_neon_vminv_u16(__rev0);
4897649360 return __ret;
4897749361}
4897849362#endif
4897949363
4898049364#ifdef __LITTLE_ENDIAN__
48981__ai uint8x8_t vceqz_s8(int8x8_t __p0) {
48982 uint8x8_t __ret;
48983 __ret = (uint8x8_t) __builtin_neon_vceqz_v((int8x8_t)__p0, 16);
49365__ai int8_t vminv_s8(int8x8_t __p0) {
49366 int8_t __ret;
49367 __ret = (int8_t) __builtin_neon_vminv_s8(__p0);
4898449368 return __ret;
4898549369}
4898649370#else
48987__ai uint8x8_t vceqz_s8(int8x8_t __p0) {
48988 uint8x8_t __ret;
49371__ai int8_t vminv_s8(int8x8_t __p0) {
49372 int8_t __ret;
4898949373 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
48990 __ret = (uint8x8_t) __builtin_neon_vceqz_v((int8x8_t)__rev0, 16);
48991 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
49374 __ret = (int8_t) __builtin_neon_vminv_s8(__rev0);
4899249375 return __ret;
4899349376}
4899449377#endif
4899549378
48996__ai uint64x1_t vceqz_f64(float64x1_t __p0) {
48997 uint64x1_t __ret;
48998 __ret = (uint64x1_t) __builtin_neon_vceqz_v((int8x8_t)__p0, 19);
48999 return __ret;
49000}
4900149379#ifdef __LITTLE_ENDIAN__
49002__ai uint32x2_t vceqz_f32(float32x2_t __p0) {
49003 uint32x2_t __ret;
49004 __ret = (uint32x2_t) __builtin_neon_vceqz_v((int8x8_t)__p0, 18);
49380__ai float32_t vminv_f32(float32x2_t __p0) {
49381 float32_t __ret;
49382 __ret = (float32_t) __builtin_neon_vminv_f32(__p0);
4900549383 return __ret;
4900649384}
4900749385#else
49008__ai uint32x2_t vceqz_f32(float32x2_t __p0) {
49009 uint32x2_t __ret;
49386__ai float32_t vminv_f32(float32x2_t __p0) {
49387 float32_t __ret;
4901049388 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49011 __ret = (uint32x2_t) __builtin_neon_vceqz_v((int8x8_t)__rev0, 18);
49012 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
49389 __ret = (float32_t) __builtin_neon_vminv_f32(__rev0);
4901349390 return __ret;
4901449391}
4901549392#endif
4901649393
4901749394#ifdef __LITTLE_ENDIAN__
49018__ai uint32x2_t vceqz_s32(int32x2_t __p0) {
49019 uint32x2_t __ret;
49020 __ret = (uint32x2_t) __builtin_neon_vceqz_v((int8x8_t)__p0, 18);
49395__ai int32_t vminv_s32(int32x2_t __p0) {
49396 int32_t __ret;
49397 __ret = (int32_t) __builtin_neon_vminv_s32(__p0);
4902149398 return __ret;
4902249399}
4902349400#else
49024__ai uint32x2_t vceqz_s32(int32x2_t __p0) {
49025 uint32x2_t __ret;
49401__ai int32_t vminv_s32(int32x2_t __p0) {
49402 int32_t __ret;
4902649403 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49027 __ret = (uint32x2_t) __builtin_neon_vceqz_v((int8x8_t)__rev0, 18);
49028 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
49404 __ret = (int32_t) __builtin_neon_vminv_s32(__rev0);
4902949405 return __ret;
4903049406}
4903149407#endif
4903249408
49033__ai uint64x1_t vceqz_s64(int64x1_t __p0) {
49034 uint64x1_t __ret;
49035 __ret = (uint64x1_t) __builtin_neon_vceqz_v((int8x8_t)__p0, 19);
49036 return __ret;
49037}
4903849409#ifdef __LITTLE_ENDIAN__
49039__ai uint16x4_t vceqz_s16(int16x4_t __p0) {
49040 uint16x4_t __ret;
49041 __ret = (uint16x4_t) __builtin_neon_vceqz_v((int8x8_t)__p0, 17);
49410__ai int16_t vminv_s16(int16x4_t __p0) {
49411 int16_t __ret;
49412 __ret = (int16_t) __builtin_neon_vminv_s16(__p0);
4904249413 return __ret;
4904349414}
4904449415#else
49045__ai uint16x4_t vceqz_s16(int16x4_t __p0) {
49046 uint16x4_t __ret;
49416__ai int16_t vminv_s16(int16x4_t __p0) {
49417 int16_t __ret;
4904749418 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
49048 __ret = (uint16x4_t) __builtin_neon_vceqz_v((int8x8_t)__rev0, 17);
49049 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
49419 __ret = (int16_t) __builtin_neon_vminv_s16(__rev0);
4905049420 return __ret;
4905149421}
4905249422#endif
4905349423
49054__ai uint64_t vceqzd_u64(uint64_t __p0) {
49055 uint64_t __ret;
49056 __ret = (uint64_t) __builtin_neon_vceqzd_u64(__p0);
49057 return __ret;
49058}
49059__ai uint64_t vceqzd_s64(int64_t __p0) {
49060 uint64_t __ret;
49061 __ret = (uint64_t) __builtin_neon_vceqzd_s64(__p0);
49062 return __ret;
49063}
49064__ai uint64_t vceqzd_f64(float64_t __p0) {
49065 uint64_t __ret;
49066 __ret = (uint64_t) __builtin_neon_vceqzd_f64(__p0);
49067 return __ret;
49068}
49069__ai uint32_t vceqzs_f32(float32_t __p0) {
49070 uint32_t __ret;
49071 __ret = (uint32_t) __builtin_neon_vceqzs_f32(__p0);
49072 return __ret;
49073}
4907449424#ifdef __LITTLE_ENDIAN__
49075__ai uint64x2_t vcgeq_u64(uint64x2_t __p0, uint64x2_t __p1) {
49076 uint64x2_t __ret;
49077 __ret = (uint64x2_t)(__p0 >= __p1);
49425__ai float64x2_t vmlaq_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
49426 float64x2_t __ret;
49427 __ret = __p0 + __p1 * __p2;
4907849428 return __ret;
4907949429}
4908049430#else
49081__ai uint64x2_t vcgeq_u64(uint64x2_t __p0, uint64x2_t __p1) {
49082 uint64x2_t __ret;
49083 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49084 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
49085 __ret = (uint64x2_t)(__rev0 >= __rev1);
49431__ai float64x2_t vmlaq_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
49432 float64x2_t __ret;
49433 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49434 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
49435 float64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
49436 __ret = __rev0 + __rev1 * __rev2;
4908649437 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4908749438 return __ret;
4908849439}
4908949440#endif
4909049441
49091#ifdef __LITTLE_ENDIAN__
49092__ai uint64x2_t vcgeq_f64(float64x2_t __p0, float64x2_t __p1) {
49093 uint64x2_t __ret;
49094 __ret = (uint64x2_t)(__p0 >= __p1);
49442__ai float64x1_t vmla_f64(float64x1_t __p0, float64x1_t __p1, float64x1_t __p2) {
49443 float64x1_t __ret;
49444 __ret = __p0 + __p1 * __p2;
4909549445 return __ret;
4909649446}
49447#ifdef __LITTLE_ENDIAN__
49448#define vmlaq_laneq_u32(__p0_427, __p1_427, __p2_427, __p3_427) __extension__ ({ \
49449 uint32x4_t __ret_427; \
49450 uint32x4_t __s0_427 = __p0_427; \
49451 uint32x4_t __s1_427 = __p1_427; \
49452 uint32x4_t __s2_427 = __p2_427; \
49453 __ret_427 = __s0_427 + __s1_427 * splatq_laneq_u32(__s2_427, __p3_427); \
49454 __ret_427; \
49455})
4909749456#else
49098__ai uint64x2_t vcgeq_f64(float64x2_t __p0, float64x2_t __p1) {
49099 uint64x2_t __ret;
49100 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49101 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
49102 __ret = (uint64x2_t)(__rev0 >= __rev1);
49103 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
49104 return __ret;
49105}
49457#define vmlaq_laneq_u32(__p0_428, __p1_428, __p2_428, __p3_428) __extension__ ({ \
49458 uint32x4_t __ret_428; \
49459 uint32x4_t __s0_428 = __p0_428; \
49460 uint32x4_t __s1_428 = __p1_428; \
49461 uint32x4_t __s2_428 = __p2_428; \
49462 uint32x4_t __rev0_428; __rev0_428 = __builtin_shufflevector(__s0_428, __s0_428, 3, 2, 1, 0); \
49463 uint32x4_t __rev1_428; __rev1_428 = __builtin_shufflevector(__s1_428, __s1_428, 3, 2, 1, 0); \
49464 uint32x4_t __rev2_428; __rev2_428 = __builtin_shufflevector(__s2_428, __s2_428, 3, 2, 1, 0); \
49465 __ret_428 = __rev0_428 + __rev1_428 * __noswap_splatq_laneq_u32(__rev2_428, __p3_428); \
49466 __ret_428 = __builtin_shufflevector(__ret_428, __ret_428, 3, 2, 1, 0); \
49467 __ret_428; \
49468})
4910649469#endif
4910749470
4910849471#ifdef __LITTLE_ENDIAN__
49109__ai uint64x2_t vcgeq_s64(int64x2_t __p0, int64x2_t __p1) {
49110 uint64x2_t __ret;
49111 __ret = (uint64x2_t)(__p0 >= __p1);
49112 return __ret;
49113}
49472#define vmlaq_laneq_u16(__p0_429, __p1_429, __p2_429, __p3_429) __extension__ ({ \
49473 uint16x8_t __ret_429; \
49474 uint16x8_t __s0_429 = __p0_429; \
49475 uint16x8_t __s1_429 = __p1_429; \
49476 uint16x8_t __s2_429 = __p2_429; \
49477 __ret_429 = __s0_429 + __s1_429 * splatq_laneq_u16(__s2_429, __p3_429); \
49478 __ret_429; \
49479})
4911449480#else
49115__ai uint64x2_t vcgeq_s64(int64x2_t __p0, int64x2_t __p1) {
49116 uint64x2_t __ret;
49117 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49118 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
49119 __ret = (uint64x2_t)(__rev0 >= __rev1);
49120 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
49121 return __ret;
49122}
49481#define vmlaq_laneq_u16(__p0_430, __p1_430, __p2_430, __p3_430) __extension__ ({ \
49482 uint16x8_t __ret_430; \
49483 uint16x8_t __s0_430 = __p0_430; \
49484 uint16x8_t __s1_430 = __p1_430; \
49485 uint16x8_t __s2_430 = __p2_430; \
49486 uint16x8_t __rev0_430; __rev0_430 = __builtin_shufflevector(__s0_430, __s0_430, 7, 6, 5, 4, 3, 2, 1, 0); \
49487 uint16x8_t __rev1_430; __rev1_430 = __builtin_shufflevector(__s1_430, __s1_430, 7, 6, 5, 4, 3, 2, 1, 0); \
49488 uint16x8_t __rev2_430; __rev2_430 = __builtin_shufflevector(__s2_430, __s2_430, 7, 6, 5, 4, 3, 2, 1, 0); \
49489 __ret_430 = __rev0_430 + __rev1_430 * __noswap_splatq_laneq_u16(__rev2_430, __p3_430); \
49490 __ret_430 = __builtin_shufflevector(__ret_430, __ret_430, 7, 6, 5, 4, 3, 2, 1, 0); \
49491 __ret_430; \
49492})
49493#endif
49494
49495#ifdef __LITTLE_ENDIAN__
49496#define vmlaq_laneq_f32(__p0_431, __p1_431, __p2_431, __p3_431) __extension__ ({ \
49497 float32x4_t __ret_431; \
49498 float32x4_t __s0_431 = __p0_431; \
49499 float32x4_t __s1_431 = __p1_431; \
49500 float32x4_t __s2_431 = __p2_431; \
49501 __ret_431 = __s0_431 + __s1_431 * splatq_laneq_f32(__s2_431, __p3_431); \
49502 __ret_431; \
49503})
49504#else
49505#define vmlaq_laneq_f32(__p0_432, __p1_432, __p2_432, __p3_432) __extension__ ({ \
49506 float32x4_t __ret_432; \
49507 float32x4_t __s0_432 = __p0_432; \
49508 float32x4_t __s1_432 = __p1_432; \
49509 float32x4_t __s2_432 = __p2_432; \
49510 float32x4_t __rev0_432; __rev0_432 = __builtin_shufflevector(__s0_432, __s0_432, 3, 2, 1, 0); \
49511 float32x4_t __rev1_432; __rev1_432 = __builtin_shufflevector(__s1_432, __s1_432, 3, 2, 1, 0); \
49512 float32x4_t __rev2_432; __rev2_432 = __builtin_shufflevector(__s2_432, __s2_432, 3, 2, 1, 0); \
49513 __ret_432 = __rev0_432 + __rev1_432 * __noswap_splatq_laneq_f32(__rev2_432, __p3_432); \
49514 __ret_432 = __builtin_shufflevector(__ret_432, __ret_432, 3, 2, 1, 0); \
49515 __ret_432; \
49516})
49517#endif
49518
49519#ifdef __LITTLE_ENDIAN__
49520#define vmlaq_laneq_s32(__p0_433, __p1_433, __p2_433, __p3_433) __extension__ ({ \
49521 int32x4_t __ret_433; \
49522 int32x4_t __s0_433 = __p0_433; \
49523 int32x4_t __s1_433 = __p1_433; \
49524 int32x4_t __s2_433 = __p2_433; \
49525 __ret_433 = __s0_433 + __s1_433 * splatq_laneq_s32(__s2_433, __p3_433); \
49526 __ret_433; \
49527})
49528#else
49529#define vmlaq_laneq_s32(__p0_434, __p1_434, __p2_434, __p3_434) __extension__ ({ \
49530 int32x4_t __ret_434; \
49531 int32x4_t __s0_434 = __p0_434; \
49532 int32x4_t __s1_434 = __p1_434; \
49533 int32x4_t __s2_434 = __p2_434; \
49534 int32x4_t __rev0_434; __rev0_434 = __builtin_shufflevector(__s0_434, __s0_434, 3, 2, 1, 0); \
49535 int32x4_t __rev1_434; __rev1_434 = __builtin_shufflevector(__s1_434, __s1_434, 3, 2, 1, 0); \
49536 int32x4_t __rev2_434; __rev2_434 = __builtin_shufflevector(__s2_434, __s2_434, 3, 2, 1, 0); \
49537 __ret_434 = __rev0_434 + __rev1_434 * __noswap_splatq_laneq_s32(__rev2_434, __p3_434); \
49538 __ret_434 = __builtin_shufflevector(__ret_434, __ret_434, 3, 2, 1, 0); \
49539 __ret_434; \
49540})
49541#endif
49542
49543#ifdef __LITTLE_ENDIAN__
49544#define vmlaq_laneq_s16(__p0_435, __p1_435, __p2_435, __p3_435) __extension__ ({ \
49545 int16x8_t __ret_435; \
49546 int16x8_t __s0_435 = __p0_435; \
49547 int16x8_t __s1_435 = __p1_435; \
49548 int16x8_t __s2_435 = __p2_435; \
49549 __ret_435 = __s0_435 + __s1_435 * splatq_laneq_s16(__s2_435, __p3_435); \
49550 __ret_435; \
49551})
49552#else
49553#define vmlaq_laneq_s16(__p0_436, __p1_436, __p2_436, __p3_436) __extension__ ({ \
49554 int16x8_t __ret_436; \
49555 int16x8_t __s0_436 = __p0_436; \
49556 int16x8_t __s1_436 = __p1_436; \
49557 int16x8_t __s2_436 = __p2_436; \
49558 int16x8_t __rev0_436; __rev0_436 = __builtin_shufflevector(__s0_436, __s0_436, 7, 6, 5, 4, 3, 2, 1, 0); \
49559 int16x8_t __rev1_436; __rev1_436 = __builtin_shufflevector(__s1_436, __s1_436, 7, 6, 5, 4, 3, 2, 1, 0); \
49560 int16x8_t __rev2_436; __rev2_436 = __builtin_shufflevector(__s2_436, __s2_436, 7, 6, 5, 4, 3, 2, 1, 0); \
49561 __ret_436 = __rev0_436 + __rev1_436 * __noswap_splatq_laneq_s16(__rev2_436, __p3_436); \
49562 __ret_436 = __builtin_shufflevector(__ret_436, __ret_436, 7, 6, 5, 4, 3, 2, 1, 0); \
49563 __ret_436; \
49564})
49565#endif
49566
49567#ifdef __LITTLE_ENDIAN__
49568#define vmla_laneq_u32(__p0_437, __p1_437, __p2_437, __p3_437) __extension__ ({ \
49569 uint32x2_t __ret_437; \
49570 uint32x2_t __s0_437 = __p0_437; \
49571 uint32x2_t __s1_437 = __p1_437; \
49572 uint32x4_t __s2_437 = __p2_437; \
49573 __ret_437 = __s0_437 + __s1_437 * splat_laneq_u32(__s2_437, __p3_437); \
49574 __ret_437; \
49575})
49576#else
49577#define vmla_laneq_u32(__p0_438, __p1_438, __p2_438, __p3_438) __extension__ ({ \
49578 uint32x2_t __ret_438; \
49579 uint32x2_t __s0_438 = __p0_438; \
49580 uint32x2_t __s1_438 = __p1_438; \
49581 uint32x4_t __s2_438 = __p2_438; \
49582 uint32x2_t __rev0_438; __rev0_438 = __builtin_shufflevector(__s0_438, __s0_438, 1, 0); \
49583 uint32x2_t __rev1_438; __rev1_438 = __builtin_shufflevector(__s1_438, __s1_438, 1, 0); \
49584 uint32x4_t __rev2_438; __rev2_438 = __builtin_shufflevector(__s2_438, __s2_438, 3, 2, 1, 0); \
49585 __ret_438 = __rev0_438 + __rev1_438 * __noswap_splat_laneq_u32(__rev2_438, __p3_438); \
49586 __ret_438 = __builtin_shufflevector(__ret_438, __ret_438, 1, 0); \
49587 __ret_438; \
49588})
49589#endif
49590
49591#ifdef __LITTLE_ENDIAN__
49592#define vmla_laneq_u16(__p0_439, __p1_439, __p2_439, __p3_439) __extension__ ({ \
49593 uint16x4_t __ret_439; \
49594 uint16x4_t __s0_439 = __p0_439; \
49595 uint16x4_t __s1_439 = __p1_439; \
49596 uint16x8_t __s2_439 = __p2_439; \
49597 __ret_439 = __s0_439 + __s1_439 * splat_laneq_u16(__s2_439, __p3_439); \
49598 __ret_439; \
49599})
49600#else
49601#define vmla_laneq_u16(__p0_440, __p1_440, __p2_440, __p3_440) __extension__ ({ \
49602 uint16x4_t __ret_440; \
49603 uint16x4_t __s0_440 = __p0_440; \
49604 uint16x4_t __s1_440 = __p1_440; \
49605 uint16x8_t __s2_440 = __p2_440; \
49606 uint16x4_t __rev0_440; __rev0_440 = __builtin_shufflevector(__s0_440, __s0_440, 3, 2, 1, 0); \
49607 uint16x4_t __rev1_440; __rev1_440 = __builtin_shufflevector(__s1_440, __s1_440, 3, 2, 1, 0); \
49608 uint16x8_t __rev2_440; __rev2_440 = __builtin_shufflevector(__s2_440, __s2_440, 7, 6, 5, 4, 3, 2, 1, 0); \
49609 __ret_440 = __rev0_440 + __rev1_440 * __noswap_splat_laneq_u16(__rev2_440, __p3_440); \
49610 __ret_440 = __builtin_shufflevector(__ret_440, __ret_440, 3, 2, 1, 0); \
49611 __ret_440; \
49612})
49613#endif
49614
49615#ifdef __LITTLE_ENDIAN__
49616#define vmla_laneq_f32(__p0_441, __p1_441, __p2_441, __p3_441) __extension__ ({ \
49617 float32x2_t __ret_441; \
49618 float32x2_t __s0_441 = __p0_441; \
49619 float32x2_t __s1_441 = __p1_441; \
49620 float32x4_t __s2_441 = __p2_441; \
49621 __ret_441 = __s0_441 + __s1_441 * splat_laneq_f32(__s2_441, __p3_441); \
49622 __ret_441; \
49623})
49624#else
49625#define vmla_laneq_f32(__p0_442, __p1_442, __p2_442, __p3_442) __extension__ ({ \
49626 float32x2_t __ret_442; \
49627 float32x2_t __s0_442 = __p0_442; \
49628 float32x2_t __s1_442 = __p1_442; \
49629 float32x4_t __s2_442 = __p2_442; \
49630 float32x2_t __rev0_442; __rev0_442 = __builtin_shufflevector(__s0_442, __s0_442, 1, 0); \
49631 float32x2_t __rev1_442; __rev1_442 = __builtin_shufflevector(__s1_442, __s1_442, 1, 0); \
49632 float32x4_t __rev2_442; __rev2_442 = __builtin_shufflevector(__s2_442, __s2_442, 3, 2, 1, 0); \
49633 __ret_442 = __rev0_442 + __rev1_442 * __noswap_splat_laneq_f32(__rev2_442, __p3_442); \
49634 __ret_442 = __builtin_shufflevector(__ret_442, __ret_442, 1, 0); \
49635 __ret_442; \
49636})
49637#endif
49638
49639#ifdef __LITTLE_ENDIAN__
49640#define vmla_laneq_s32(__p0_443, __p1_443, __p2_443, __p3_443) __extension__ ({ \
49641 int32x2_t __ret_443; \
49642 int32x2_t __s0_443 = __p0_443; \
49643 int32x2_t __s1_443 = __p1_443; \
49644 int32x4_t __s2_443 = __p2_443; \
49645 __ret_443 = __s0_443 + __s1_443 * splat_laneq_s32(__s2_443, __p3_443); \
49646 __ret_443; \
49647})
49648#else
49649#define vmla_laneq_s32(__p0_444, __p1_444, __p2_444, __p3_444) __extension__ ({ \
49650 int32x2_t __ret_444; \
49651 int32x2_t __s0_444 = __p0_444; \
49652 int32x2_t __s1_444 = __p1_444; \
49653 int32x4_t __s2_444 = __p2_444; \
49654 int32x2_t __rev0_444; __rev0_444 = __builtin_shufflevector(__s0_444, __s0_444, 1, 0); \
49655 int32x2_t __rev1_444; __rev1_444 = __builtin_shufflevector(__s1_444, __s1_444, 1, 0); \
49656 int32x4_t __rev2_444; __rev2_444 = __builtin_shufflevector(__s2_444, __s2_444, 3, 2, 1, 0); \
49657 __ret_444 = __rev0_444 + __rev1_444 * __noswap_splat_laneq_s32(__rev2_444, __p3_444); \
49658 __ret_444 = __builtin_shufflevector(__ret_444, __ret_444, 1, 0); \
49659 __ret_444; \
49660})
49661#endif
49662
49663#ifdef __LITTLE_ENDIAN__
49664#define vmla_laneq_s16(__p0_445, __p1_445, __p2_445, __p3_445) __extension__ ({ \
49665 int16x4_t __ret_445; \
49666 int16x4_t __s0_445 = __p0_445; \
49667 int16x4_t __s1_445 = __p1_445; \
49668 int16x8_t __s2_445 = __p2_445; \
49669 __ret_445 = __s0_445 + __s1_445 * splat_laneq_s16(__s2_445, __p3_445); \
49670 __ret_445; \
49671})
49672#else
49673#define vmla_laneq_s16(__p0_446, __p1_446, __p2_446, __p3_446) __extension__ ({ \
49674 int16x4_t __ret_446; \
49675 int16x4_t __s0_446 = __p0_446; \
49676 int16x4_t __s1_446 = __p1_446; \
49677 int16x8_t __s2_446 = __p2_446; \
49678 int16x4_t __rev0_446; __rev0_446 = __builtin_shufflevector(__s0_446, __s0_446, 3, 2, 1, 0); \
49679 int16x4_t __rev1_446; __rev1_446 = __builtin_shufflevector(__s1_446, __s1_446, 3, 2, 1, 0); \
49680 int16x8_t __rev2_446; __rev2_446 = __builtin_shufflevector(__s2_446, __s2_446, 7, 6, 5, 4, 3, 2, 1, 0); \
49681 __ret_446 = __rev0_446 + __rev1_446 * __noswap_splat_laneq_s16(__rev2_446, __p3_446); \
49682 __ret_446 = __builtin_shufflevector(__ret_446, __ret_446, 3, 2, 1, 0); \
49683 __ret_446; \
49684})
49685#endif
49686
49687#ifdef __LITTLE_ENDIAN__
49688#define vmlal_high_lane_u32(__p0_447, __p1_447, __p2_447, __p3_447) __extension__ ({ \
49689 uint64x2_t __ret_447; \
49690 uint64x2_t __s0_447 = __p0_447; \
49691 uint32x4_t __s1_447 = __p1_447; \
49692 uint32x2_t __s2_447 = __p2_447; \
49693 __ret_447 = __s0_447 + vmull_u32(vget_high_u32(__s1_447), splat_lane_u32(__s2_447, __p3_447)); \
49694 __ret_447; \
49695})
49696#else
49697#define vmlal_high_lane_u32(__p0_448, __p1_448, __p2_448, __p3_448) __extension__ ({ \
49698 uint64x2_t __ret_448; \
49699 uint64x2_t __s0_448 = __p0_448; \
49700 uint32x4_t __s1_448 = __p1_448; \
49701 uint32x2_t __s2_448 = __p2_448; \
49702 uint64x2_t __rev0_448; __rev0_448 = __builtin_shufflevector(__s0_448, __s0_448, 1, 0); \
49703 uint32x4_t __rev1_448; __rev1_448 = __builtin_shufflevector(__s1_448, __s1_448, 3, 2, 1, 0); \
49704 uint32x2_t __rev2_448; __rev2_448 = __builtin_shufflevector(__s2_448, __s2_448, 1, 0); \
49705 __ret_448 = __rev0_448 + __noswap_vmull_u32(__noswap_vget_high_u32(__rev1_448), __noswap_splat_lane_u32(__rev2_448, __p3_448)); \
49706 __ret_448 = __builtin_shufflevector(__ret_448, __ret_448, 1, 0); \
49707 __ret_448; \
49708})
49709#endif
49710
49711#ifdef __LITTLE_ENDIAN__
49712#define vmlal_high_lane_u16(__p0_449, __p1_449, __p2_449, __p3_449) __extension__ ({ \
49713 uint32x4_t __ret_449; \
49714 uint32x4_t __s0_449 = __p0_449; \
49715 uint16x8_t __s1_449 = __p1_449; \
49716 uint16x4_t __s2_449 = __p2_449; \
49717 __ret_449 = __s0_449 + vmull_u16(vget_high_u16(__s1_449), splat_lane_u16(__s2_449, __p3_449)); \
49718 __ret_449; \
49719})
49720#else
49721#define vmlal_high_lane_u16(__p0_450, __p1_450, __p2_450, __p3_450) __extension__ ({ \
49722 uint32x4_t __ret_450; \
49723 uint32x4_t __s0_450 = __p0_450; \
49724 uint16x8_t __s1_450 = __p1_450; \
49725 uint16x4_t __s2_450 = __p2_450; \
49726 uint32x4_t __rev0_450; __rev0_450 = __builtin_shufflevector(__s0_450, __s0_450, 3, 2, 1, 0); \
49727 uint16x8_t __rev1_450; __rev1_450 = __builtin_shufflevector(__s1_450, __s1_450, 7, 6, 5, 4, 3, 2, 1, 0); \
49728 uint16x4_t __rev2_450; __rev2_450 = __builtin_shufflevector(__s2_450, __s2_450, 3, 2, 1, 0); \
49729 __ret_450 = __rev0_450 + __noswap_vmull_u16(__noswap_vget_high_u16(__rev1_450), __noswap_splat_lane_u16(__rev2_450, __p3_450)); \
49730 __ret_450 = __builtin_shufflevector(__ret_450, __ret_450, 3, 2, 1, 0); \
49731 __ret_450; \
49732})
49733#endif
49734
49735#ifdef __LITTLE_ENDIAN__
49736#define vmlal_high_lane_s32(__p0_451, __p1_451, __p2_451, __p3_451) __extension__ ({ \
49737 int64x2_t __ret_451; \
49738 int64x2_t __s0_451 = __p0_451; \
49739 int32x4_t __s1_451 = __p1_451; \
49740 int32x2_t __s2_451 = __p2_451; \
49741 __ret_451 = __s0_451 + vmull_s32(vget_high_s32(__s1_451), splat_lane_s32(__s2_451, __p3_451)); \
49742 __ret_451; \
49743})
49744#else
49745#define vmlal_high_lane_s32(__p0_452, __p1_452, __p2_452, __p3_452) __extension__ ({ \
49746 int64x2_t __ret_452; \
49747 int64x2_t __s0_452 = __p0_452; \
49748 int32x4_t __s1_452 = __p1_452; \
49749 int32x2_t __s2_452 = __p2_452; \
49750 int64x2_t __rev0_452; __rev0_452 = __builtin_shufflevector(__s0_452, __s0_452, 1, 0); \
49751 int32x4_t __rev1_452; __rev1_452 = __builtin_shufflevector(__s1_452, __s1_452, 3, 2, 1, 0); \
49752 int32x2_t __rev2_452; __rev2_452 = __builtin_shufflevector(__s2_452, __s2_452, 1, 0); \
49753 __ret_452 = __rev0_452 + __noswap_vmull_s32(__noswap_vget_high_s32(__rev1_452), __noswap_splat_lane_s32(__rev2_452, __p3_452)); \
49754 __ret_452 = __builtin_shufflevector(__ret_452, __ret_452, 1, 0); \
49755 __ret_452; \
49756})
49757#endif
49758
49759#ifdef __LITTLE_ENDIAN__
49760#define vmlal_high_lane_s16(__p0_453, __p1_453, __p2_453, __p3_453) __extension__ ({ \
49761 int32x4_t __ret_453; \
49762 int32x4_t __s0_453 = __p0_453; \
49763 int16x8_t __s1_453 = __p1_453; \
49764 int16x4_t __s2_453 = __p2_453; \
49765 __ret_453 = __s0_453 + vmull_s16(vget_high_s16(__s1_453), splat_lane_s16(__s2_453, __p3_453)); \
49766 __ret_453; \
49767})
49768#else
49769#define vmlal_high_lane_s16(__p0_454, __p1_454, __p2_454, __p3_454) __extension__ ({ \
49770 int32x4_t __ret_454; \
49771 int32x4_t __s0_454 = __p0_454; \
49772 int16x8_t __s1_454 = __p1_454; \
49773 int16x4_t __s2_454 = __p2_454; \
49774 int32x4_t __rev0_454; __rev0_454 = __builtin_shufflevector(__s0_454, __s0_454, 3, 2, 1, 0); \
49775 int16x8_t __rev1_454; __rev1_454 = __builtin_shufflevector(__s1_454, __s1_454, 7, 6, 5, 4, 3, 2, 1, 0); \
49776 int16x4_t __rev2_454; __rev2_454 = __builtin_shufflevector(__s2_454, __s2_454, 3, 2, 1, 0); \
49777 __ret_454 = __rev0_454 + __noswap_vmull_s16(__noswap_vget_high_s16(__rev1_454), __noswap_splat_lane_s16(__rev2_454, __p3_454)); \
49778 __ret_454 = __builtin_shufflevector(__ret_454, __ret_454, 3, 2, 1, 0); \
49779 __ret_454; \
49780})
49781#endif
49782
49783#ifdef __LITTLE_ENDIAN__
49784#define vmlal_high_laneq_u32(__p0_455, __p1_455, __p2_455, __p3_455) __extension__ ({ \
49785 uint64x2_t __ret_455; \
49786 uint64x2_t __s0_455 = __p0_455; \
49787 uint32x4_t __s1_455 = __p1_455; \
49788 uint32x4_t __s2_455 = __p2_455; \
49789 __ret_455 = __s0_455 + vmull_u32(vget_high_u32(__s1_455), splat_laneq_u32(__s2_455, __p3_455)); \
49790 __ret_455; \
49791})
49792#else
49793#define vmlal_high_laneq_u32(__p0_456, __p1_456, __p2_456, __p3_456) __extension__ ({ \
49794 uint64x2_t __ret_456; \
49795 uint64x2_t __s0_456 = __p0_456; \
49796 uint32x4_t __s1_456 = __p1_456; \
49797 uint32x4_t __s2_456 = __p2_456; \
49798 uint64x2_t __rev0_456; __rev0_456 = __builtin_shufflevector(__s0_456, __s0_456, 1, 0); \
49799 uint32x4_t __rev1_456; __rev1_456 = __builtin_shufflevector(__s1_456, __s1_456, 3, 2, 1, 0); \
49800 uint32x4_t __rev2_456; __rev2_456 = __builtin_shufflevector(__s2_456, __s2_456, 3, 2, 1, 0); \
49801 __ret_456 = __rev0_456 + __noswap_vmull_u32(__noswap_vget_high_u32(__rev1_456), __noswap_splat_laneq_u32(__rev2_456, __p3_456)); \
49802 __ret_456 = __builtin_shufflevector(__ret_456, __ret_456, 1, 0); \
49803 __ret_456; \
49804})
49805#endif
49806
49807#ifdef __LITTLE_ENDIAN__
49808#define vmlal_high_laneq_u16(__p0_457, __p1_457, __p2_457, __p3_457) __extension__ ({ \
49809 uint32x4_t __ret_457; \
49810 uint32x4_t __s0_457 = __p0_457; \
49811 uint16x8_t __s1_457 = __p1_457; \
49812 uint16x8_t __s2_457 = __p2_457; \
49813 __ret_457 = __s0_457 + vmull_u16(vget_high_u16(__s1_457), splat_laneq_u16(__s2_457, __p3_457)); \
49814 __ret_457; \
49815})
49816#else
49817#define vmlal_high_laneq_u16(__p0_458, __p1_458, __p2_458, __p3_458) __extension__ ({ \
49818 uint32x4_t __ret_458; \
49819 uint32x4_t __s0_458 = __p0_458; \
49820 uint16x8_t __s1_458 = __p1_458; \
49821 uint16x8_t __s2_458 = __p2_458; \
49822 uint32x4_t __rev0_458; __rev0_458 = __builtin_shufflevector(__s0_458, __s0_458, 3, 2, 1, 0); \
49823 uint16x8_t __rev1_458; __rev1_458 = __builtin_shufflevector(__s1_458, __s1_458, 7, 6, 5, 4, 3, 2, 1, 0); \
49824 uint16x8_t __rev2_458; __rev2_458 = __builtin_shufflevector(__s2_458, __s2_458, 7, 6, 5, 4, 3, 2, 1, 0); \
49825 __ret_458 = __rev0_458 + __noswap_vmull_u16(__noswap_vget_high_u16(__rev1_458), __noswap_splat_laneq_u16(__rev2_458, __p3_458)); \
49826 __ret_458 = __builtin_shufflevector(__ret_458, __ret_458, 3, 2, 1, 0); \
49827 __ret_458; \
49828})
49829#endif
49830
49831#ifdef __LITTLE_ENDIAN__
49832#define vmlal_high_laneq_s32(__p0_459, __p1_459, __p2_459, __p3_459) __extension__ ({ \
49833 int64x2_t __ret_459; \
49834 int64x2_t __s0_459 = __p0_459; \
49835 int32x4_t __s1_459 = __p1_459; \
49836 int32x4_t __s2_459 = __p2_459; \
49837 __ret_459 = __s0_459 + vmull_s32(vget_high_s32(__s1_459), splat_laneq_s32(__s2_459, __p3_459)); \
49838 __ret_459; \
49839})
49840#else
49841#define vmlal_high_laneq_s32(__p0_460, __p1_460, __p2_460, __p3_460) __extension__ ({ \
49842 int64x2_t __ret_460; \
49843 int64x2_t __s0_460 = __p0_460; \
49844 int32x4_t __s1_460 = __p1_460; \
49845 int32x4_t __s2_460 = __p2_460; \
49846 int64x2_t __rev0_460; __rev0_460 = __builtin_shufflevector(__s0_460, __s0_460, 1, 0); \
49847 int32x4_t __rev1_460; __rev1_460 = __builtin_shufflevector(__s1_460, __s1_460, 3, 2, 1, 0); \
49848 int32x4_t __rev2_460; __rev2_460 = __builtin_shufflevector(__s2_460, __s2_460, 3, 2, 1, 0); \
49849 __ret_460 = __rev0_460 + __noswap_vmull_s32(__noswap_vget_high_s32(__rev1_460), __noswap_splat_laneq_s32(__rev2_460, __p3_460)); \
49850 __ret_460 = __builtin_shufflevector(__ret_460, __ret_460, 1, 0); \
49851 __ret_460; \
49852})
49853#endif
49854
49855#ifdef __LITTLE_ENDIAN__
49856#define vmlal_high_laneq_s16(__p0_461, __p1_461, __p2_461, __p3_461) __extension__ ({ \
49857 int32x4_t __ret_461; \
49858 int32x4_t __s0_461 = __p0_461; \
49859 int16x8_t __s1_461 = __p1_461; \
49860 int16x8_t __s2_461 = __p2_461; \
49861 __ret_461 = __s0_461 + vmull_s16(vget_high_s16(__s1_461), splat_laneq_s16(__s2_461, __p3_461)); \
49862 __ret_461; \
49863})
49864#else
49865#define vmlal_high_laneq_s16(__p0_462, __p1_462, __p2_462, __p3_462) __extension__ ({ \
49866 int32x4_t __ret_462; \
49867 int32x4_t __s0_462 = __p0_462; \
49868 int16x8_t __s1_462 = __p1_462; \
49869 int16x8_t __s2_462 = __p2_462; \
49870 int32x4_t __rev0_462; __rev0_462 = __builtin_shufflevector(__s0_462, __s0_462, 3, 2, 1, 0); \
49871 int16x8_t __rev1_462; __rev1_462 = __builtin_shufflevector(__s1_462, __s1_462, 7, 6, 5, 4, 3, 2, 1, 0); \
49872 int16x8_t __rev2_462; __rev2_462 = __builtin_shufflevector(__s2_462, __s2_462, 7, 6, 5, 4, 3, 2, 1, 0); \
49873 __ret_462 = __rev0_462 + __noswap_vmull_s16(__noswap_vget_high_s16(__rev1_462), __noswap_splat_laneq_s16(__rev2_462, __p3_462)); \
49874 __ret_462 = __builtin_shufflevector(__ret_462, __ret_462, 3, 2, 1, 0); \
49875 __ret_462; \
49876})
49877#endif
49878
49879#ifdef __LITTLE_ENDIAN__
49880#define vmlal_laneq_u32(__p0_463, __p1_463, __p2_463, __p3_463) __extension__ ({ \
49881 uint64x2_t __ret_463; \
49882 uint64x2_t __s0_463 = __p0_463; \
49883 uint32x2_t __s1_463 = __p1_463; \
49884 uint32x4_t __s2_463 = __p2_463; \
49885 __ret_463 = __s0_463 + vmull_u32(__s1_463, splat_laneq_u32(__s2_463, __p3_463)); \
49886 __ret_463; \
49887})
49888#else
49889#define vmlal_laneq_u32(__p0_464, __p1_464, __p2_464, __p3_464) __extension__ ({ \
49890 uint64x2_t __ret_464; \
49891 uint64x2_t __s0_464 = __p0_464; \
49892 uint32x2_t __s1_464 = __p1_464; \
49893 uint32x4_t __s2_464 = __p2_464; \
49894 uint64x2_t __rev0_464; __rev0_464 = __builtin_shufflevector(__s0_464, __s0_464, 1, 0); \
49895 uint32x2_t __rev1_464; __rev1_464 = __builtin_shufflevector(__s1_464, __s1_464, 1, 0); \
49896 uint32x4_t __rev2_464; __rev2_464 = __builtin_shufflevector(__s2_464, __s2_464, 3, 2, 1, 0); \
49897 __ret_464 = __rev0_464 + __noswap_vmull_u32(__rev1_464, __noswap_splat_laneq_u32(__rev2_464, __p3_464)); \
49898 __ret_464 = __builtin_shufflevector(__ret_464, __ret_464, 1, 0); \
49899 __ret_464; \
49900})
49901#endif
49902
49903#ifdef __LITTLE_ENDIAN__
49904#define vmlal_laneq_u16(__p0_465, __p1_465, __p2_465, __p3_465) __extension__ ({ \
49905 uint32x4_t __ret_465; \
49906 uint32x4_t __s0_465 = __p0_465; \
49907 uint16x4_t __s1_465 = __p1_465; \
49908 uint16x8_t __s2_465 = __p2_465; \
49909 __ret_465 = __s0_465 + vmull_u16(__s1_465, splat_laneq_u16(__s2_465, __p3_465)); \
49910 __ret_465; \
49911})
49912#else
49913#define vmlal_laneq_u16(__p0_466, __p1_466, __p2_466, __p3_466) __extension__ ({ \
49914 uint32x4_t __ret_466; \
49915 uint32x4_t __s0_466 = __p0_466; \
49916 uint16x4_t __s1_466 = __p1_466; \
49917 uint16x8_t __s2_466 = __p2_466; \
49918 uint32x4_t __rev0_466; __rev0_466 = __builtin_shufflevector(__s0_466, __s0_466, 3, 2, 1, 0); \
49919 uint16x4_t __rev1_466; __rev1_466 = __builtin_shufflevector(__s1_466, __s1_466, 3, 2, 1, 0); \
49920 uint16x8_t __rev2_466; __rev2_466 = __builtin_shufflevector(__s2_466, __s2_466, 7, 6, 5, 4, 3, 2, 1, 0); \
49921 __ret_466 = __rev0_466 + __noswap_vmull_u16(__rev1_466, __noswap_splat_laneq_u16(__rev2_466, __p3_466)); \
49922 __ret_466 = __builtin_shufflevector(__ret_466, __ret_466, 3, 2, 1, 0); \
49923 __ret_466; \
49924})
4912349925#endif
4912449926
49125__ai uint64x1_t vcge_u64(uint64x1_t __p0, uint64x1_t __p1) {
49126 uint64x1_t __ret;
49127 __ret = (uint64x1_t)(__p0 >= __p1);
49128 return __ret;
49129}
49130__ai uint64x1_t vcge_f64(float64x1_t __p0, float64x1_t __p1) {
49131 uint64x1_t __ret;
49132 __ret = (uint64x1_t)(__p0 >= __p1);
49133 return __ret;
49134}
49135__ai uint64x1_t vcge_s64(int64x1_t __p0, int64x1_t __p1) {
49136 uint64x1_t __ret;
49137 __ret = (uint64x1_t)(__p0 >= __p1);
49138 return __ret;
49139}
49140__ai uint64_t vcged_s64(int64_t __p0, int64_t __p1) {
49141 uint64_t __ret;
49142 __ret = (uint64_t) __builtin_neon_vcged_s64(__p0, __p1);
49143 return __ret;
49144}
49145__ai uint64_t vcged_u64(uint64_t __p0, uint64_t __p1) {
49146 uint64_t __ret;
49147 __ret = (uint64_t) __builtin_neon_vcged_u64(__p0, __p1);
49148 return __ret;
49149}
49150__ai uint64_t vcged_f64(float64_t __p0, float64_t __p1) {
49151 uint64_t __ret;
49152 __ret = (uint64_t) __builtin_neon_vcged_f64(__p0, __p1);
49153 return __ret;
49154}
49155__ai uint32_t vcges_f32(float32_t __p0, float32_t __p1) {
49156 uint32_t __ret;
49157 __ret = (uint32_t) __builtin_neon_vcges_f32(__p0, __p1);
49158 return __ret;
49159}
4916049927#ifdef __LITTLE_ENDIAN__
49161__ai uint8x16_t vcgezq_s8(int8x16_t __p0) {
49162 uint8x16_t __ret;
49163 __ret = (uint8x16_t) __builtin_neon_vcgezq_v((int8x16_t)__p0, 48);
49164 return __ret;
49165}
49928#define vmlal_laneq_s32(__p0_467, __p1_467, __p2_467, __p3_467) __extension__ ({ \
49929 int64x2_t __ret_467; \
49930 int64x2_t __s0_467 = __p0_467; \
49931 int32x2_t __s1_467 = __p1_467; \
49932 int32x4_t __s2_467 = __p2_467; \
49933 __ret_467 = __s0_467 + vmull_s32(__s1_467, splat_laneq_s32(__s2_467, __p3_467)); \
49934 __ret_467; \
49935})
4916649936#else
49167__ai uint8x16_t vcgezq_s8(int8x16_t __p0) {
49168 uint8x16_t __ret;
49169 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
49170 __ret = (uint8x16_t) __builtin_neon_vcgezq_v((int8x16_t)__rev0, 48);
49171 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
49172 return __ret;
49173}
49937#define vmlal_laneq_s32(__p0_468, __p1_468, __p2_468, __p3_468) __extension__ ({ \
49938 int64x2_t __ret_468; \
49939 int64x2_t __s0_468 = __p0_468; \
49940 int32x2_t __s1_468 = __p1_468; \
49941 int32x4_t __s2_468 = __p2_468; \
49942 int64x2_t __rev0_468; __rev0_468 = __builtin_shufflevector(__s0_468, __s0_468, 1, 0); \
49943 int32x2_t __rev1_468; __rev1_468 = __builtin_shufflevector(__s1_468, __s1_468, 1, 0); \
49944 int32x4_t __rev2_468; __rev2_468 = __builtin_shufflevector(__s2_468, __s2_468, 3, 2, 1, 0); \
49945 __ret_468 = __rev0_468 + __noswap_vmull_s32(__rev1_468, __noswap_splat_laneq_s32(__rev2_468, __p3_468)); \
49946 __ret_468 = __builtin_shufflevector(__ret_468, __ret_468, 1, 0); \
49947 __ret_468; \
49948})
4917449949#endif
4917549950
4917649951#ifdef __LITTLE_ENDIAN__
49177__ai uint64x2_t vcgezq_f64(float64x2_t __p0) {
49178 uint64x2_t __ret;
49179 __ret = (uint64x2_t) __builtin_neon_vcgezq_v((int8x16_t)__p0, 51);
49180 return __ret;
49181}
49952#define vmlal_laneq_s16(__p0_469, __p1_469, __p2_469, __p3_469) __extension__ ({ \
49953 int32x4_t __ret_469; \
49954 int32x4_t __s0_469 = __p0_469; \
49955 int16x4_t __s1_469 = __p1_469; \
49956 int16x8_t __s2_469 = __p2_469; \
49957 __ret_469 = __s0_469 + vmull_s16(__s1_469, splat_laneq_s16(__s2_469, __p3_469)); \
49958 __ret_469; \
49959})
4918249960#else
49183__ai uint64x2_t vcgezq_f64(float64x2_t __p0) {
49184 uint64x2_t __ret;
49185 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49186 __ret = (uint64x2_t) __builtin_neon_vcgezq_v((int8x16_t)__rev0, 51);
49187 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
49188 return __ret;
49189}
49961#define vmlal_laneq_s16(__p0_470, __p1_470, __p2_470, __p3_470) __extension__ ({ \
49962 int32x4_t __ret_470; \
49963 int32x4_t __s0_470 = __p0_470; \
49964 int16x4_t __s1_470 = __p1_470; \
49965 int16x8_t __s2_470 = __p2_470; \
49966 int32x4_t __rev0_470; __rev0_470 = __builtin_shufflevector(__s0_470, __s0_470, 3, 2, 1, 0); \
49967 int16x4_t __rev1_470; __rev1_470 = __builtin_shufflevector(__s1_470, __s1_470, 3, 2, 1, 0); \
49968 int16x8_t __rev2_470; __rev2_470 = __builtin_shufflevector(__s2_470, __s2_470, 7, 6, 5, 4, 3, 2, 1, 0); \
49969 __ret_470 = __rev0_470 + __noswap_vmull_s16(__rev1_470, __noswap_splat_laneq_s16(__rev2_470, __p3_470)); \
49970 __ret_470 = __builtin_shufflevector(__ret_470, __ret_470, 3, 2, 1, 0); \
49971 __ret_470; \
49972})
4919049973#endif
4919149974
4919249975#ifdef __LITTLE_ENDIAN__
49193__ai uint32x4_t vcgezq_f32(float32x4_t __p0) {
49194 uint32x4_t __ret;
49195 __ret = (uint32x4_t) __builtin_neon_vcgezq_v((int8x16_t)__p0, 50);
49976__ai float64x2_t vmlsq_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
49977 float64x2_t __ret;
49978 __ret = __p0 - __p1 * __p2;
4919649979 return __ret;
4919749980}
4919849981#else
49199__ai uint32x4_t vcgezq_f32(float32x4_t __p0) {
49200 uint32x4_t __ret;
49201 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
49202 __ret = (uint32x4_t) __builtin_neon_vcgezq_v((int8x16_t)__rev0, 50);
49203 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
49982__ai float64x2_t vmlsq_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
49983 float64x2_t __ret;
49984 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49985 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
49986 float64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
49987 __ret = __rev0 - __rev1 * __rev2;
49988 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4920449989 return __ret;
4920549990}
4920649991#endif
4920749992
49208#ifdef __LITTLE_ENDIAN__
49209__ai uint32x4_t vcgezq_s32(int32x4_t __p0) {
49210 uint32x4_t __ret;
49211 __ret = (uint32x4_t) __builtin_neon_vcgezq_v((int8x16_t)__p0, 50);
49993__ai float64x1_t vmls_f64(float64x1_t __p0, float64x1_t __p1, float64x1_t __p2) {
49994 float64x1_t __ret;
49995 __ret = __p0 - __p1 * __p2;
4921249996 return __ret;
4921349997}
49998#ifdef __LITTLE_ENDIAN__
49999#define vmlsq_laneq_u32(__p0_471, __p1_471, __p2_471, __p3_471) __extension__ ({ \
50000 uint32x4_t __ret_471; \
50001 uint32x4_t __s0_471 = __p0_471; \
50002 uint32x4_t __s1_471 = __p1_471; \
50003 uint32x4_t __s2_471 = __p2_471; \
50004 __ret_471 = __s0_471 - __s1_471 * splatq_laneq_u32(__s2_471, __p3_471); \
50005 __ret_471; \
50006})
4921450007#else
49215__ai uint32x4_t vcgezq_s32(int32x4_t __p0) {
49216 uint32x4_t __ret;
49217 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
49218 __ret = (uint32x4_t) __builtin_neon_vcgezq_v((int8x16_t)__rev0, 50);
49219 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
49220 return __ret;
49221}
50008#define vmlsq_laneq_u32(__p0_472, __p1_472, __p2_472, __p3_472) __extension__ ({ \
50009 uint32x4_t __ret_472; \
50010 uint32x4_t __s0_472 = __p0_472; \
50011 uint32x4_t __s1_472 = __p1_472; \
50012 uint32x4_t __s2_472 = __p2_472; \
50013 uint32x4_t __rev0_472; __rev0_472 = __builtin_shufflevector(__s0_472, __s0_472, 3, 2, 1, 0); \
50014 uint32x4_t __rev1_472; __rev1_472 = __builtin_shufflevector(__s1_472, __s1_472, 3, 2, 1, 0); \
50015 uint32x4_t __rev2_472; __rev2_472 = __builtin_shufflevector(__s2_472, __s2_472, 3, 2, 1, 0); \
50016 __ret_472 = __rev0_472 - __rev1_472 * __noswap_splatq_laneq_u32(__rev2_472, __p3_472); \
50017 __ret_472 = __builtin_shufflevector(__ret_472, __ret_472, 3, 2, 1, 0); \
50018 __ret_472; \
50019})
4922250020#endif
4922350021
4922450022#ifdef __LITTLE_ENDIAN__
49225__ai uint64x2_t vcgezq_s64(int64x2_t __p0) {
49226 uint64x2_t __ret;
49227 __ret = (uint64x2_t) __builtin_neon_vcgezq_v((int8x16_t)__p0, 51);
49228 return __ret;
49229}
50023#define vmlsq_laneq_u16(__p0_473, __p1_473, __p2_473, __p3_473) __extension__ ({ \
50024 uint16x8_t __ret_473; \
50025 uint16x8_t __s0_473 = __p0_473; \
50026 uint16x8_t __s1_473 = __p1_473; \
50027 uint16x8_t __s2_473 = __p2_473; \
50028 __ret_473 = __s0_473 - __s1_473 * splatq_laneq_u16(__s2_473, __p3_473); \
50029 __ret_473; \
50030})
4923050031#else
49231__ai uint64x2_t vcgezq_s64(int64x2_t __p0) {
49232 uint64x2_t __ret;
49233 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49234 __ret = (uint64x2_t) __builtin_neon_vcgezq_v((int8x16_t)__rev0, 51);
49235 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
49236 return __ret;
49237}
50032#define vmlsq_laneq_u16(__p0_474, __p1_474, __p2_474, __p3_474) __extension__ ({ \
50033 uint16x8_t __ret_474; \
50034 uint16x8_t __s0_474 = __p0_474; \
50035 uint16x8_t __s1_474 = __p1_474; \
50036 uint16x8_t __s2_474 = __p2_474; \
50037 uint16x8_t __rev0_474; __rev0_474 = __builtin_shufflevector(__s0_474, __s0_474, 7, 6, 5, 4, 3, 2, 1, 0); \
50038 uint16x8_t __rev1_474; __rev1_474 = __builtin_shufflevector(__s1_474, __s1_474, 7, 6, 5, 4, 3, 2, 1, 0); \
50039 uint16x8_t __rev2_474; __rev2_474 = __builtin_shufflevector(__s2_474, __s2_474, 7, 6, 5, 4, 3, 2, 1, 0); \
50040 __ret_474 = __rev0_474 - __rev1_474 * __noswap_splatq_laneq_u16(__rev2_474, __p3_474); \
50041 __ret_474 = __builtin_shufflevector(__ret_474, __ret_474, 7, 6, 5, 4, 3, 2, 1, 0); \
50042 __ret_474; \
50043})
4923850044#endif
4923950045
4924050046#ifdef __LITTLE_ENDIAN__
49241__ai uint16x8_t vcgezq_s16(int16x8_t __p0) {
49242 uint16x8_t __ret;
49243 __ret = (uint16x8_t) __builtin_neon_vcgezq_v((int8x16_t)__p0, 49);
49244 return __ret;
49245}
50047#define vmlsq_laneq_f32(__p0_475, __p1_475, __p2_475, __p3_475) __extension__ ({ \
50048 float32x4_t __ret_475; \
50049 float32x4_t __s0_475 = __p0_475; \
50050 float32x4_t __s1_475 = __p1_475; \
50051 float32x4_t __s2_475 = __p2_475; \
50052 __ret_475 = __s0_475 - __s1_475 * splatq_laneq_f32(__s2_475, __p3_475); \
50053 __ret_475; \
50054})
4924650055#else
49247__ai uint16x8_t vcgezq_s16(int16x8_t __p0) {
49248 uint16x8_t __ret;
49249 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
49250 __ret = (uint16x8_t) __builtin_neon_vcgezq_v((int8x16_t)__rev0, 49);
49251 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
49252 return __ret;
49253}
50056#define vmlsq_laneq_f32(__p0_476, __p1_476, __p2_476, __p3_476) __extension__ ({ \
50057 float32x4_t __ret_476; \
50058 float32x4_t __s0_476 = __p0_476; \
50059 float32x4_t __s1_476 = __p1_476; \
50060 float32x4_t __s2_476 = __p2_476; \
50061 float32x4_t __rev0_476; __rev0_476 = __builtin_shufflevector(__s0_476, __s0_476, 3, 2, 1, 0); \
50062 float32x4_t __rev1_476; __rev1_476 = __builtin_shufflevector(__s1_476, __s1_476, 3, 2, 1, 0); \
50063 float32x4_t __rev2_476; __rev2_476 = __builtin_shufflevector(__s2_476, __s2_476, 3, 2, 1, 0); \
50064 __ret_476 = __rev0_476 - __rev1_476 * __noswap_splatq_laneq_f32(__rev2_476, __p3_476); \
50065 __ret_476 = __builtin_shufflevector(__ret_476, __ret_476, 3, 2, 1, 0); \
50066 __ret_476; \
50067})
4925450068#endif
4925550069
4925650070#ifdef __LITTLE_ENDIAN__
49257__ai uint8x8_t vcgez_s8(int8x8_t __p0) {
49258 uint8x8_t __ret;
49259 __ret = (uint8x8_t) __builtin_neon_vcgez_v((int8x8_t)__p0, 16);
49260 return __ret;
49261}
50071#define vmlsq_laneq_s32(__p0_477, __p1_477, __p2_477, __p3_477) __extension__ ({ \
50072 int32x4_t __ret_477; \
50073 int32x4_t __s0_477 = __p0_477; \
50074 int32x4_t __s1_477 = __p1_477; \
50075 int32x4_t __s2_477 = __p2_477; \
50076 __ret_477 = __s0_477 - __s1_477 * splatq_laneq_s32(__s2_477, __p3_477); \
50077 __ret_477; \
50078})
4926250079#else
49263__ai uint8x8_t vcgez_s8(int8x8_t __p0) {
49264 uint8x8_t __ret;
49265 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
49266 __ret = (uint8x8_t) __builtin_neon_vcgez_v((int8x8_t)__rev0, 16);
49267 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
49268 return __ret;
49269}
50080#define vmlsq_laneq_s32(__p0_478, __p1_478, __p2_478, __p3_478) __extension__ ({ \
50081 int32x4_t __ret_478; \
50082 int32x4_t __s0_478 = __p0_478; \
50083 int32x4_t __s1_478 = __p1_478; \
50084 int32x4_t __s2_478 = __p2_478; \
50085 int32x4_t __rev0_478; __rev0_478 = __builtin_shufflevector(__s0_478, __s0_478, 3, 2, 1, 0); \
50086 int32x4_t __rev1_478; __rev1_478 = __builtin_shufflevector(__s1_478, __s1_478, 3, 2, 1, 0); \
50087 int32x4_t __rev2_478; __rev2_478 = __builtin_shufflevector(__s2_478, __s2_478, 3, 2, 1, 0); \
50088 __ret_478 = __rev0_478 - __rev1_478 * __noswap_splatq_laneq_s32(__rev2_478, __p3_478); \
50089 __ret_478 = __builtin_shufflevector(__ret_478, __ret_478, 3, 2, 1, 0); \
50090 __ret_478; \
50091})
4927050092#endif
4927150093
49272__ai uint64x1_t vcgez_f64(float64x1_t __p0) {
49273 uint64x1_t __ret;
49274 __ret = (uint64x1_t) __builtin_neon_vcgez_v((int8x8_t)__p0, 19);
49275 return __ret;
49276}
4927750094#ifdef __LITTLE_ENDIAN__
49278__ai uint32x2_t vcgez_f32(float32x2_t __p0) {
49279 uint32x2_t __ret;
49280 __ret = (uint32x2_t) __builtin_neon_vcgez_v((int8x8_t)__p0, 18);
49281 return __ret;
49282}
50095#define vmlsq_laneq_s16(__p0_479, __p1_479, __p2_479, __p3_479) __extension__ ({ \
50096 int16x8_t __ret_479; \
50097 int16x8_t __s0_479 = __p0_479; \
50098 int16x8_t __s1_479 = __p1_479; \
50099 int16x8_t __s2_479 = __p2_479; \
50100 __ret_479 = __s0_479 - __s1_479 * splatq_laneq_s16(__s2_479, __p3_479); \
50101 __ret_479; \
50102})
4928350103#else
49284__ai uint32x2_t vcgez_f32(float32x2_t __p0) {
49285 uint32x2_t __ret;
49286 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49287 __ret = (uint32x2_t) __builtin_neon_vcgez_v((int8x8_t)__rev0, 18);
49288 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
49289 return __ret;
49290}
50104#define vmlsq_laneq_s16(__p0_480, __p1_480, __p2_480, __p3_480) __extension__ ({ \
50105 int16x8_t __ret_480; \
50106 int16x8_t __s0_480 = __p0_480; \
50107 int16x8_t __s1_480 = __p1_480; \
50108 int16x8_t __s2_480 = __p2_480; \
50109 int16x8_t __rev0_480; __rev0_480 = __builtin_shufflevector(__s0_480, __s0_480, 7, 6, 5, 4, 3, 2, 1, 0); \
50110 int16x8_t __rev1_480; __rev1_480 = __builtin_shufflevector(__s1_480, __s1_480, 7, 6, 5, 4, 3, 2, 1, 0); \
50111 int16x8_t __rev2_480; __rev2_480 = __builtin_shufflevector(__s2_480, __s2_480, 7, 6, 5, 4, 3, 2, 1, 0); \
50112 __ret_480 = __rev0_480 - __rev1_480 * __noswap_splatq_laneq_s16(__rev2_480, __p3_480); \
50113 __ret_480 = __builtin_shufflevector(__ret_480, __ret_480, 7, 6, 5, 4, 3, 2, 1, 0); \
50114 __ret_480; \
50115})
4929150116#endif
4929250117
4929350118#ifdef __LITTLE_ENDIAN__
49294__ai uint32x2_t vcgez_s32(int32x2_t __p0) {
49295 uint32x2_t __ret;
49296 __ret = (uint32x2_t) __builtin_neon_vcgez_v((int8x8_t)__p0, 18);
49297 return __ret;
49298}
50119#define vmls_laneq_u32(__p0_481, __p1_481, __p2_481, __p3_481) __extension__ ({ \
50120 uint32x2_t __ret_481; \
50121 uint32x2_t __s0_481 = __p0_481; \
50122 uint32x2_t __s1_481 = __p1_481; \
50123 uint32x4_t __s2_481 = __p2_481; \
50124 __ret_481 = __s0_481 - __s1_481 * splat_laneq_u32(__s2_481, __p3_481); \
50125 __ret_481; \
50126})
4929950127#else
49300__ai uint32x2_t vcgez_s32(int32x2_t __p0) {
49301 uint32x2_t __ret;
49302 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49303 __ret = (uint32x2_t) __builtin_neon_vcgez_v((int8x8_t)__rev0, 18);
49304 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
49305 return __ret;
49306}
50128#define vmls_laneq_u32(__p0_482, __p1_482, __p2_482, __p3_482) __extension__ ({ \
50129 uint32x2_t __ret_482; \
50130 uint32x2_t __s0_482 = __p0_482; \
50131 uint32x2_t __s1_482 = __p1_482; \
50132 uint32x4_t __s2_482 = __p2_482; \
50133 uint32x2_t __rev0_482; __rev0_482 = __builtin_shufflevector(__s0_482, __s0_482, 1, 0); \
50134 uint32x2_t __rev1_482; __rev1_482 = __builtin_shufflevector(__s1_482, __s1_482, 1, 0); \
50135 uint32x4_t __rev2_482; __rev2_482 = __builtin_shufflevector(__s2_482, __s2_482, 3, 2, 1, 0); \
50136 __ret_482 = __rev0_482 - __rev1_482 * __noswap_splat_laneq_u32(__rev2_482, __p3_482); \
50137 __ret_482 = __builtin_shufflevector(__ret_482, __ret_482, 1, 0); \
50138 __ret_482; \
50139})
4930750140#endif
4930850141
49309__ai uint64x1_t vcgez_s64(int64x1_t __p0) {
49310 uint64x1_t __ret;
49311 __ret = (uint64x1_t) __builtin_neon_vcgez_v((int8x8_t)__p0, 19);
49312 return __ret;
49313}
4931450142#ifdef __LITTLE_ENDIAN__
49315__ai uint16x4_t vcgez_s16(int16x4_t __p0) {
49316 uint16x4_t __ret;
49317 __ret = (uint16x4_t) __builtin_neon_vcgez_v((int8x8_t)__p0, 17);
49318 return __ret;
49319}
50143#define vmls_laneq_u16(__p0_483, __p1_483, __p2_483, __p3_483) __extension__ ({ \
50144 uint16x4_t __ret_483; \
50145 uint16x4_t __s0_483 = __p0_483; \
50146 uint16x4_t __s1_483 = __p1_483; \
50147 uint16x8_t __s2_483 = __p2_483; \
50148 __ret_483 = __s0_483 - __s1_483 * splat_laneq_u16(__s2_483, __p3_483); \
50149 __ret_483; \
50150})
4932050151#else
49321__ai uint16x4_t vcgez_s16(int16x4_t __p0) {
49322 uint16x4_t __ret;
49323 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
49324 __ret = (uint16x4_t) __builtin_neon_vcgez_v((int8x8_t)__rev0, 17);
49325 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
49326 return __ret;
49327}
50152#define vmls_laneq_u16(__p0_484, __p1_484, __p2_484, __p3_484) __extension__ ({ \
50153 uint16x4_t __ret_484; \
50154 uint16x4_t __s0_484 = __p0_484; \
50155 uint16x4_t __s1_484 = __p1_484; \
50156 uint16x8_t __s2_484 = __p2_484; \
50157 uint16x4_t __rev0_484; __rev0_484 = __builtin_shufflevector(__s0_484, __s0_484, 3, 2, 1, 0); \
50158 uint16x4_t __rev1_484; __rev1_484 = __builtin_shufflevector(__s1_484, __s1_484, 3, 2, 1, 0); \
50159 uint16x8_t __rev2_484; __rev2_484 = __builtin_shufflevector(__s2_484, __s2_484, 7, 6, 5, 4, 3, 2, 1, 0); \
50160 __ret_484 = __rev0_484 - __rev1_484 * __noswap_splat_laneq_u16(__rev2_484, __p3_484); \
50161 __ret_484 = __builtin_shufflevector(__ret_484, __ret_484, 3, 2, 1, 0); \
50162 __ret_484; \
50163})
4932850164#endif
4932950165
49330__ai uint64_t vcgezd_s64(int64_t __p0) {
49331 uint64_t __ret;
49332 __ret = (uint64_t) __builtin_neon_vcgezd_s64(__p0);
49333 return __ret;
49334}
49335__ai uint64_t vcgezd_f64(float64_t __p0) {
49336 uint64_t __ret;
49337 __ret = (uint64_t) __builtin_neon_vcgezd_f64(__p0);
49338 return __ret;
49339}
49340__ai uint32_t vcgezs_f32(float32_t __p0) {
49341 uint32_t __ret;
49342 __ret = (uint32_t) __builtin_neon_vcgezs_f32(__p0);
49343 return __ret;
49344}
4934550166#ifdef __LITTLE_ENDIAN__
49346__ai uint64x2_t vcgtq_u64(uint64x2_t __p0, uint64x2_t __p1) {
49347 uint64x2_t __ret;
49348 __ret = (uint64x2_t)(__p0 > __p1);
49349 return __ret;
49350}
50167#define vmls_laneq_f32(__p0_485, __p1_485, __p2_485, __p3_485) __extension__ ({ \
50168 float32x2_t __ret_485; \
50169 float32x2_t __s0_485 = __p0_485; \
50170 float32x2_t __s1_485 = __p1_485; \
50171 float32x4_t __s2_485 = __p2_485; \
50172 __ret_485 = __s0_485 - __s1_485 * splat_laneq_f32(__s2_485, __p3_485); \
50173 __ret_485; \
50174})
4935150175#else
49352__ai uint64x2_t vcgtq_u64(uint64x2_t __p0, uint64x2_t __p1) {
49353 uint64x2_t __ret;
49354 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49355 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
49356 __ret = (uint64x2_t)(__rev0 > __rev1);
49357 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
49358 return __ret;
49359}
50176#define vmls_laneq_f32(__p0_486, __p1_486, __p2_486, __p3_486) __extension__ ({ \
50177 float32x2_t __ret_486; \
50178 float32x2_t __s0_486 = __p0_486; \
50179 float32x2_t __s1_486 = __p1_486; \
50180 float32x4_t __s2_486 = __p2_486; \
50181 float32x2_t __rev0_486; __rev0_486 = __builtin_shufflevector(__s0_486, __s0_486, 1, 0); \
50182 float32x2_t __rev1_486; __rev1_486 = __builtin_shufflevector(__s1_486, __s1_486, 1, 0); \
50183 float32x4_t __rev2_486; __rev2_486 = __builtin_shufflevector(__s2_486, __s2_486, 3, 2, 1, 0); \
50184 __ret_486 = __rev0_486 - __rev1_486 * __noswap_splat_laneq_f32(__rev2_486, __p3_486); \
50185 __ret_486 = __builtin_shufflevector(__ret_486, __ret_486, 1, 0); \
50186 __ret_486; \
50187})
4936050188#endif
4936150189
4936250190#ifdef __LITTLE_ENDIAN__
49363__ai uint64x2_t vcgtq_f64(float64x2_t __p0, float64x2_t __p1) {
49364 uint64x2_t __ret;
49365 __ret = (uint64x2_t)(__p0 > __p1);
49366 return __ret;
49367}
50191#define vmls_laneq_s32(__p0_487, __p1_487, __p2_487, __p3_487) __extension__ ({ \
50192 int32x2_t __ret_487; \
50193 int32x2_t __s0_487 = __p0_487; \
50194 int32x2_t __s1_487 = __p1_487; \
50195 int32x4_t __s2_487 = __p2_487; \
50196 __ret_487 = __s0_487 - __s1_487 * splat_laneq_s32(__s2_487, __p3_487); \
50197 __ret_487; \
50198})
4936850199#else
49369__ai uint64x2_t vcgtq_f64(float64x2_t __p0, float64x2_t __p1) {
49370 uint64x2_t __ret;
49371 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49372 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
49373 __ret = (uint64x2_t)(__rev0 > __rev1);
49374 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
49375 return __ret;
49376}
50200#define vmls_laneq_s32(__p0_488, __p1_488, __p2_488, __p3_488) __extension__ ({ \
50201 int32x2_t __ret_488; \
50202 int32x2_t __s0_488 = __p0_488; \
50203 int32x2_t __s1_488 = __p1_488; \
50204 int32x4_t __s2_488 = __p2_488; \
50205 int32x2_t __rev0_488; __rev0_488 = __builtin_shufflevector(__s0_488, __s0_488, 1, 0); \
50206 int32x2_t __rev1_488; __rev1_488 = __builtin_shufflevector(__s1_488, __s1_488, 1, 0); \
50207 int32x4_t __rev2_488; __rev2_488 = __builtin_shufflevector(__s2_488, __s2_488, 3, 2, 1, 0); \
50208 __ret_488 = __rev0_488 - __rev1_488 * __noswap_splat_laneq_s32(__rev2_488, __p3_488); \
50209 __ret_488 = __builtin_shufflevector(__ret_488, __ret_488, 1, 0); \
50210 __ret_488; \
50211})
4937750212#endif
4937850213
4937950214#ifdef __LITTLE_ENDIAN__
49380__ai uint64x2_t vcgtq_s64(int64x2_t __p0, int64x2_t __p1) {
49381 uint64x2_t __ret;
49382 __ret = (uint64x2_t)(__p0 > __p1);
49383 return __ret;
49384}
50215#define vmls_laneq_s16(__p0_489, __p1_489, __p2_489, __p3_489) __extension__ ({ \
50216 int16x4_t __ret_489; \
50217 int16x4_t __s0_489 = __p0_489; \
50218 int16x4_t __s1_489 = __p1_489; \
50219 int16x8_t __s2_489 = __p2_489; \
50220 __ret_489 = __s0_489 - __s1_489 * splat_laneq_s16(__s2_489, __p3_489); \
50221 __ret_489; \
50222})
4938550223#else
49386__ai uint64x2_t vcgtq_s64(int64x2_t __p0, int64x2_t __p1) {
49387 uint64x2_t __ret;
49388 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49389 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
49390 __ret = (uint64x2_t)(__rev0 > __rev1);
49391 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
49392 return __ret;
49393}
50224#define vmls_laneq_s16(__p0_490, __p1_490, __p2_490, __p3_490) __extension__ ({ \
50225 int16x4_t __ret_490; \
50226 int16x4_t __s0_490 = __p0_490; \
50227 int16x4_t __s1_490 = __p1_490; \
50228 int16x8_t __s2_490 = __p2_490; \
50229 int16x4_t __rev0_490; __rev0_490 = __builtin_shufflevector(__s0_490, __s0_490, 3, 2, 1, 0); \
50230 int16x4_t __rev1_490; __rev1_490 = __builtin_shufflevector(__s1_490, __s1_490, 3, 2, 1, 0); \
50231 int16x8_t __rev2_490; __rev2_490 = __builtin_shufflevector(__s2_490, __s2_490, 7, 6, 5, 4, 3, 2, 1, 0); \
50232 __ret_490 = __rev0_490 - __rev1_490 * __noswap_splat_laneq_s16(__rev2_490, __p3_490); \
50233 __ret_490 = __builtin_shufflevector(__ret_490, __ret_490, 3, 2, 1, 0); \
50234 __ret_490; \
50235})
4939450236#endif
4939550237
49396__ai uint64x1_t vcgt_u64(uint64x1_t __p0, uint64x1_t __p1) {
49397 uint64x1_t __ret;
49398 __ret = (uint64x1_t)(__p0 > __p1);
49399 return __ret;
49400}
49401__ai uint64x1_t vcgt_f64(float64x1_t __p0, float64x1_t __p1) {
49402 uint64x1_t __ret;
49403 __ret = (uint64x1_t)(__p0 > __p1);
49404 return __ret;
49405}
49406__ai uint64x1_t vcgt_s64(int64x1_t __p0, int64x1_t __p1) {
49407 uint64x1_t __ret;
49408 __ret = (uint64x1_t)(__p0 > __p1);
49409 return __ret;
49410}
49411__ai uint64_t vcgtd_s64(int64_t __p0, int64_t __p1) {
49412 uint64_t __ret;
49413 __ret = (uint64_t) __builtin_neon_vcgtd_s64(__p0, __p1);
49414 return __ret;
49415}
49416__ai uint64_t vcgtd_u64(uint64_t __p0, uint64_t __p1) {
49417 uint64_t __ret;
49418 __ret = (uint64_t) __builtin_neon_vcgtd_u64(__p0, __p1);
49419 return __ret;
49420}
49421__ai uint64_t vcgtd_f64(float64_t __p0, float64_t __p1) {
49422 uint64_t __ret;
49423 __ret = (uint64_t) __builtin_neon_vcgtd_f64(__p0, __p1);
49424 return __ret;
49425}
49426__ai uint32_t vcgts_f32(float32_t __p0, float32_t __p1) {
49427 uint32_t __ret;
49428 __ret = (uint32_t) __builtin_neon_vcgts_f32(__p0, __p1);
49429 return __ret;
49430}
4943150238#ifdef __LITTLE_ENDIAN__
49432__ai uint8x16_t vcgtzq_s8(int8x16_t __p0) {
49433 uint8x16_t __ret;
49434 __ret = (uint8x16_t) __builtin_neon_vcgtzq_v((int8x16_t)__p0, 48);
49435 return __ret;
49436}
50239#define vmlsl_high_lane_u32(__p0_491, __p1_491, __p2_491, __p3_491) __extension__ ({ \
50240 uint64x2_t __ret_491; \
50241 uint64x2_t __s0_491 = __p0_491; \
50242 uint32x4_t __s1_491 = __p1_491; \
50243 uint32x2_t __s2_491 = __p2_491; \
50244 __ret_491 = __s0_491 - vmull_u32(vget_high_u32(__s1_491), splat_lane_u32(__s2_491, __p3_491)); \
50245 __ret_491; \
50246})
4943750247#else
49438__ai uint8x16_t vcgtzq_s8(int8x16_t __p0) {
49439 uint8x16_t __ret;
49440 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
49441 __ret = (uint8x16_t) __builtin_neon_vcgtzq_v((int8x16_t)__rev0, 48);
49442 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
49443 return __ret;
49444}
50248#define vmlsl_high_lane_u32(__p0_492, __p1_492, __p2_492, __p3_492) __extension__ ({ \
50249 uint64x2_t __ret_492; \
50250 uint64x2_t __s0_492 = __p0_492; \
50251 uint32x4_t __s1_492 = __p1_492; \
50252 uint32x2_t __s2_492 = __p2_492; \
50253 uint64x2_t __rev0_492; __rev0_492 = __builtin_shufflevector(__s0_492, __s0_492, 1, 0); \
50254 uint32x4_t __rev1_492; __rev1_492 = __builtin_shufflevector(__s1_492, __s1_492, 3, 2, 1, 0); \
50255 uint32x2_t __rev2_492; __rev2_492 = __builtin_shufflevector(__s2_492, __s2_492, 1, 0); \
50256 __ret_492 = __rev0_492 - __noswap_vmull_u32(__noswap_vget_high_u32(__rev1_492), __noswap_splat_lane_u32(__rev2_492, __p3_492)); \
50257 __ret_492 = __builtin_shufflevector(__ret_492, __ret_492, 1, 0); \
50258 __ret_492; \
50259})
4944550260#endif
4944650261
4944750262#ifdef __LITTLE_ENDIAN__
49448__ai uint64x2_t vcgtzq_f64(float64x2_t __p0) {
49449 uint64x2_t __ret;
49450 __ret = (uint64x2_t) __builtin_neon_vcgtzq_v((int8x16_t)__p0, 51);
49451 return __ret;
49452}
50263#define vmlsl_high_lane_u16(__p0_493, __p1_493, __p2_493, __p3_493) __extension__ ({ \
50264 uint32x4_t __ret_493; \
50265 uint32x4_t __s0_493 = __p0_493; \
50266 uint16x8_t __s1_493 = __p1_493; \
50267 uint16x4_t __s2_493 = __p2_493; \
50268 __ret_493 = __s0_493 - vmull_u16(vget_high_u16(__s1_493), splat_lane_u16(__s2_493, __p3_493)); \
50269 __ret_493; \
50270})
4945350271#else
49454__ai uint64x2_t vcgtzq_f64(float64x2_t __p0) {
49455 uint64x2_t __ret;
49456 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49457 __ret = (uint64x2_t) __builtin_neon_vcgtzq_v((int8x16_t)__rev0, 51);
49458 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
49459 return __ret;
49460}
50272#define vmlsl_high_lane_u16(__p0_494, __p1_494, __p2_494, __p3_494) __extension__ ({ \
50273 uint32x4_t __ret_494; \
50274 uint32x4_t __s0_494 = __p0_494; \
50275 uint16x8_t __s1_494 = __p1_494; \
50276 uint16x4_t __s2_494 = __p2_494; \
50277 uint32x4_t __rev0_494; __rev0_494 = __builtin_shufflevector(__s0_494, __s0_494, 3, 2, 1, 0); \
50278 uint16x8_t __rev1_494; __rev1_494 = __builtin_shufflevector(__s1_494, __s1_494, 7, 6, 5, 4, 3, 2, 1, 0); \
50279 uint16x4_t __rev2_494; __rev2_494 = __builtin_shufflevector(__s2_494, __s2_494, 3, 2, 1, 0); \
50280 __ret_494 = __rev0_494 - __noswap_vmull_u16(__noswap_vget_high_u16(__rev1_494), __noswap_splat_lane_u16(__rev2_494, __p3_494)); \
50281 __ret_494 = __builtin_shufflevector(__ret_494, __ret_494, 3, 2, 1, 0); \
50282 __ret_494; \
50283})
4946150284#endif
4946250285
4946350286#ifdef __LITTLE_ENDIAN__
49464__ai uint32x4_t vcgtzq_f32(float32x4_t __p0) {
49465 uint32x4_t __ret;
49466 __ret = (uint32x4_t) __builtin_neon_vcgtzq_v((int8x16_t)__p0, 50);
49467 return __ret;
49468}
50287#define vmlsl_high_lane_s32(__p0_495, __p1_495, __p2_495, __p3_495) __extension__ ({ \
50288 int64x2_t __ret_495; \
50289 int64x2_t __s0_495 = __p0_495; \
50290 int32x4_t __s1_495 = __p1_495; \
50291 int32x2_t __s2_495 = __p2_495; \
50292 __ret_495 = __s0_495 - vmull_s32(vget_high_s32(__s1_495), splat_lane_s32(__s2_495, __p3_495)); \
50293 __ret_495; \
50294})
4946950295#else
49470__ai uint32x4_t vcgtzq_f32(float32x4_t __p0) {
49471 uint32x4_t __ret;
49472 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
49473 __ret = (uint32x4_t) __builtin_neon_vcgtzq_v((int8x16_t)__rev0, 50);
49474 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
49475 return __ret;
49476}
50296#define vmlsl_high_lane_s32(__p0_496, __p1_496, __p2_496, __p3_496) __extension__ ({ \
50297 int64x2_t __ret_496; \
50298 int64x2_t __s0_496 = __p0_496; \
50299 int32x4_t __s1_496 = __p1_496; \
50300 int32x2_t __s2_496 = __p2_496; \
50301 int64x2_t __rev0_496; __rev0_496 = __builtin_shufflevector(__s0_496, __s0_496, 1, 0); \
50302 int32x4_t __rev1_496; __rev1_496 = __builtin_shufflevector(__s1_496, __s1_496, 3, 2, 1, 0); \
50303 int32x2_t __rev2_496; __rev2_496 = __builtin_shufflevector(__s2_496, __s2_496, 1, 0); \
50304 __ret_496 = __rev0_496 - __noswap_vmull_s32(__noswap_vget_high_s32(__rev1_496), __noswap_splat_lane_s32(__rev2_496, __p3_496)); \
50305 __ret_496 = __builtin_shufflevector(__ret_496, __ret_496, 1, 0); \
50306 __ret_496; \
50307})
4947750308#endif
4947850309
4947950310#ifdef __LITTLE_ENDIAN__
49480__ai uint32x4_t vcgtzq_s32(int32x4_t __p0) {
49481 uint32x4_t __ret;
49482 __ret = (uint32x4_t) __builtin_neon_vcgtzq_v((int8x16_t)__p0, 50);
49483 return __ret;
49484}
50311#define vmlsl_high_lane_s16(__p0_497, __p1_497, __p2_497, __p3_497) __extension__ ({ \
50312 int32x4_t __ret_497; \
50313 int32x4_t __s0_497 = __p0_497; \
50314 int16x8_t __s1_497 = __p1_497; \
50315 int16x4_t __s2_497 = __p2_497; \
50316 __ret_497 = __s0_497 - vmull_s16(vget_high_s16(__s1_497), splat_lane_s16(__s2_497, __p3_497)); \
50317 __ret_497; \
50318})
4948550319#else
49486__ai uint32x4_t vcgtzq_s32(int32x4_t __p0) {
49487 uint32x4_t __ret;
49488 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
49489 __ret = (uint32x4_t) __builtin_neon_vcgtzq_v((int8x16_t)__rev0, 50);
49490 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
49491 return __ret;
49492}
50320#define vmlsl_high_lane_s16(__p0_498, __p1_498, __p2_498, __p3_498) __extension__ ({ \
50321 int32x4_t __ret_498; \
50322 int32x4_t __s0_498 = __p0_498; \
50323 int16x8_t __s1_498 = __p1_498; \
50324 int16x4_t __s2_498 = __p2_498; \
50325 int32x4_t __rev0_498; __rev0_498 = __builtin_shufflevector(__s0_498, __s0_498, 3, 2, 1, 0); \
50326 int16x8_t __rev1_498; __rev1_498 = __builtin_shufflevector(__s1_498, __s1_498, 7, 6, 5, 4, 3, 2, 1, 0); \
50327 int16x4_t __rev2_498; __rev2_498 = __builtin_shufflevector(__s2_498, __s2_498, 3, 2, 1, 0); \
50328 __ret_498 = __rev0_498 - __noswap_vmull_s16(__noswap_vget_high_s16(__rev1_498), __noswap_splat_lane_s16(__rev2_498, __p3_498)); \
50329 __ret_498 = __builtin_shufflevector(__ret_498, __ret_498, 3, 2, 1, 0); \
50330 __ret_498; \
50331})
4949350332#endif
4949450333
4949550334#ifdef __LITTLE_ENDIAN__
49496__ai uint64x2_t vcgtzq_s64(int64x2_t __p0) {
49497 uint64x2_t __ret;
49498 __ret = (uint64x2_t) __builtin_neon_vcgtzq_v((int8x16_t)__p0, 51);
49499 return __ret;
49500}
50335#define vmlsl_high_laneq_u32(__p0_499, __p1_499, __p2_499, __p3_499) __extension__ ({ \
50336 uint64x2_t __ret_499; \
50337 uint64x2_t __s0_499 = __p0_499; \
50338 uint32x4_t __s1_499 = __p1_499; \
50339 uint32x4_t __s2_499 = __p2_499; \
50340 __ret_499 = __s0_499 - vmull_u32(vget_high_u32(__s1_499), splat_laneq_u32(__s2_499, __p3_499)); \
50341 __ret_499; \
50342})
4950150343#else
49502__ai uint64x2_t vcgtzq_s64(int64x2_t __p0) {
49503 uint64x2_t __ret;
49504 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49505 __ret = (uint64x2_t) __builtin_neon_vcgtzq_v((int8x16_t)__rev0, 51);
49506 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
49507 return __ret;
49508}
50344#define vmlsl_high_laneq_u32(__p0_500, __p1_500, __p2_500, __p3_500) __extension__ ({ \
50345 uint64x2_t __ret_500; \
50346 uint64x2_t __s0_500 = __p0_500; \
50347 uint32x4_t __s1_500 = __p1_500; \
50348 uint32x4_t __s2_500 = __p2_500; \
50349 uint64x2_t __rev0_500; __rev0_500 = __builtin_shufflevector(__s0_500, __s0_500, 1, 0); \
50350 uint32x4_t __rev1_500; __rev1_500 = __builtin_shufflevector(__s1_500, __s1_500, 3, 2, 1, 0); \
50351 uint32x4_t __rev2_500; __rev2_500 = __builtin_shufflevector(__s2_500, __s2_500, 3, 2, 1, 0); \
50352 __ret_500 = __rev0_500 - __noswap_vmull_u32(__noswap_vget_high_u32(__rev1_500), __noswap_splat_laneq_u32(__rev2_500, __p3_500)); \
50353 __ret_500 = __builtin_shufflevector(__ret_500, __ret_500, 1, 0); \
50354 __ret_500; \
50355})
4950950356#endif
4951050357
4951150358#ifdef __LITTLE_ENDIAN__
49512__ai uint16x8_t vcgtzq_s16(int16x8_t __p0) {
49513 uint16x8_t __ret;
49514 __ret = (uint16x8_t) __builtin_neon_vcgtzq_v((int8x16_t)__p0, 49);
49515 return __ret;
49516}
50359#define vmlsl_high_laneq_u16(__p0_501, __p1_501, __p2_501, __p3_501) __extension__ ({ \
50360 uint32x4_t __ret_501; \
50361 uint32x4_t __s0_501 = __p0_501; \
50362 uint16x8_t __s1_501 = __p1_501; \
50363 uint16x8_t __s2_501 = __p2_501; \
50364 __ret_501 = __s0_501 - vmull_u16(vget_high_u16(__s1_501), splat_laneq_u16(__s2_501, __p3_501)); \
50365 __ret_501; \
50366})
4951750367#else
49518__ai uint16x8_t vcgtzq_s16(int16x8_t __p0) {
49519 uint16x8_t __ret;
49520 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
49521 __ret = (uint16x8_t) __builtin_neon_vcgtzq_v((int8x16_t)__rev0, 49);
49522 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
49523 return __ret;
49524}
50368#define vmlsl_high_laneq_u16(__p0_502, __p1_502, __p2_502, __p3_502) __extension__ ({ \
50369 uint32x4_t __ret_502; \
50370 uint32x4_t __s0_502 = __p0_502; \
50371 uint16x8_t __s1_502 = __p1_502; \
50372 uint16x8_t __s2_502 = __p2_502; \
50373 uint32x4_t __rev0_502; __rev0_502 = __builtin_shufflevector(__s0_502, __s0_502, 3, 2, 1, 0); \
50374 uint16x8_t __rev1_502; __rev1_502 = __builtin_shufflevector(__s1_502, __s1_502, 7, 6, 5, 4, 3, 2, 1, 0); \
50375 uint16x8_t __rev2_502; __rev2_502 = __builtin_shufflevector(__s2_502, __s2_502, 7, 6, 5, 4, 3, 2, 1, 0); \
50376 __ret_502 = __rev0_502 - __noswap_vmull_u16(__noswap_vget_high_u16(__rev1_502), __noswap_splat_laneq_u16(__rev2_502, __p3_502)); \
50377 __ret_502 = __builtin_shufflevector(__ret_502, __ret_502, 3, 2, 1, 0); \
50378 __ret_502; \
50379})
4952550380#endif
4952650381
4952750382#ifdef __LITTLE_ENDIAN__
49528__ai uint8x8_t vcgtz_s8(int8x8_t __p0) {
49529 uint8x8_t __ret;
49530 __ret = (uint8x8_t) __builtin_neon_vcgtz_v((int8x8_t)__p0, 16);
49531 return __ret;
49532}
50383#define vmlsl_high_laneq_s32(__p0_503, __p1_503, __p2_503, __p3_503) __extension__ ({ \
50384 int64x2_t __ret_503; \
50385 int64x2_t __s0_503 = __p0_503; \
50386 int32x4_t __s1_503 = __p1_503; \
50387 int32x4_t __s2_503 = __p2_503; \
50388 __ret_503 = __s0_503 - vmull_s32(vget_high_s32(__s1_503), splat_laneq_s32(__s2_503, __p3_503)); \
50389 __ret_503; \
50390})
4953350391#else
49534__ai uint8x8_t vcgtz_s8(int8x8_t __p0) {
49535 uint8x8_t __ret;
49536 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
49537 __ret = (uint8x8_t) __builtin_neon_vcgtz_v((int8x8_t)__rev0, 16);
49538 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
49539 return __ret;
49540}
50392#define vmlsl_high_laneq_s32(__p0_504, __p1_504, __p2_504, __p3_504) __extension__ ({ \
50393 int64x2_t __ret_504; \
50394 int64x2_t __s0_504 = __p0_504; \
50395 int32x4_t __s1_504 = __p1_504; \
50396 int32x4_t __s2_504 = __p2_504; \
50397 int64x2_t __rev0_504; __rev0_504 = __builtin_shufflevector(__s0_504, __s0_504, 1, 0); \
50398 int32x4_t __rev1_504; __rev1_504 = __builtin_shufflevector(__s1_504, __s1_504, 3, 2, 1, 0); \
50399 int32x4_t __rev2_504; __rev2_504 = __builtin_shufflevector(__s2_504, __s2_504, 3, 2, 1, 0); \
50400 __ret_504 = __rev0_504 - __noswap_vmull_s32(__noswap_vget_high_s32(__rev1_504), __noswap_splat_laneq_s32(__rev2_504, __p3_504)); \
50401 __ret_504 = __builtin_shufflevector(__ret_504, __ret_504, 1, 0); \
50402 __ret_504; \
50403})
4954150404#endif
4954250405
49543__ai uint64x1_t vcgtz_f64(float64x1_t __p0) {
49544 uint64x1_t __ret;
49545 __ret = (uint64x1_t) __builtin_neon_vcgtz_v((int8x8_t)__p0, 19);
49546 return __ret;
49547}
4954850406#ifdef __LITTLE_ENDIAN__
49549__ai uint32x2_t vcgtz_f32(float32x2_t __p0) {
49550 uint32x2_t __ret;
49551 __ret = (uint32x2_t) __builtin_neon_vcgtz_v((int8x8_t)__p0, 18);
49552 return __ret;
49553}
50407#define vmlsl_high_laneq_s16(__p0_505, __p1_505, __p2_505, __p3_505) __extension__ ({ \
50408 int32x4_t __ret_505; \
50409 int32x4_t __s0_505 = __p0_505; \
50410 int16x8_t __s1_505 = __p1_505; \
50411 int16x8_t __s2_505 = __p2_505; \
50412 __ret_505 = __s0_505 - vmull_s16(vget_high_s16(__s1_505), splat_laneq_s16(__s2_505, __p3_505)); \
50413 __ret_505; \
50414})
4955450415#else
49555__ai uint32x2_t vcgtz_f32(float32x2_t __p0) {
49556 uint32x2_t __ret;
49557 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49558 __ret = (uint32x2_t) __builtin_neon_vcgtz_v((int8x8_t)__rev0, 18);
49559 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
49560 return __ret;
49561}
50416#define vmlsl_high_laneq_s16(__p0_506, __p1_506, __p2_506, __p3_506) __extension__ ({ \
50417 int32x4_t __ret_506; \
50418 int32x4_t __s0_506 = __p0_506; \
50419 int16x8_t __s1_506 = __p1_506; \
50420 int16x8_t __s2_506 = __p2_506; \
50421 int32x4_t __rev0_506; __rev0_506 = __builtin_shufflevector(__s0_506, __s0_506, 3, 2, 1, 0); \
50422 int16x8_t __rev1_506; __rev1_506 = __builtin_shufflevector(__s1_506, __s1_506, 7, 6, 5, 4, 3, 2, 1, 0); \
50423 int16x8_t __rev2_506; __rev2_506 = __builtin_shufflevector(__s2_506, __s2_506, 7, 6, 5, 4, 3, 2, 1, 0); \
50424 __ret_506 = __rev0_506 - __noswap_vmull_s16(__noswap_vget_high_s16(__rev1_506), __noswap_splat_laneq_s16(__rev2_506, __p3_506)); \
50425 __ret_506 = __builtin_shufflevector(__ret_506, __ret_506, 3, 2, 1, 0); \
50426 __ret_506; \
50427})
4956250428#endif
4956350429
4956450430#ifdef __LITTLE_ENDIAN__
49565__ai uint32x2_t vcgtz_s32(int32x2_t __p0) {
49566 uint32x2_t __ret;
49567 __ret = (uint32x2_t) __builtin_neon_vcgtz_v((int8x8_t)__p0, 18);
49568 return __ret;
49569}
50431#define vmlsl_laneq_u32(__p0_507, __p1_507, __p2_507, __p3_507) __extension__ ({ \
50432 uint64x2_t __ret_507; \
50433 uint64x2_t __s0_507 = __p0_507; \
50434 uint32x2_t __s1_507 = __p1_507; \
50435 uint32x4_t __s2_507 = __p2_507; \
50436 __ret_507 = __s0_507 - vmull_u32(__s1_507, splat_laneq_u32(__s2_507, __p3_507)); \
50437 __ret_507; \
50438})
4957050439#else
49571__ai uint32x2_t vcgtz_s32(int32x2_t __p0) {
49572 uint32x2_t __ret;
49573 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49574 __ret = (uint32x2_t) __builtin_neon_vcgtz_v((int8x8_t)__rev0, 18);
49575 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
49576 return __ret;
49577}
50440#define vmlsl_laneq_u32(__p0_508, __p1_508, __p2_508, __p3_508) __extension__ ({ \
50441 uint64x2_t __ret_508; \
50442 uint64x2_t __s0_508 = __p0_508; \
50443 uint32x2_t __s1_508 = __p1_508; \
50444 uint32x4_t __s2_508 = __p2_508; \
50445 uint64x2_t __rev0_508; __rev0_508 = __builtin_shufflevector(__s0_508, __s0_508, 1, 0); \
50446 uint32x2_t __rev1_508; __rev1_508 = __builtin_shufflevector(__s1_508, __s1_508, 1, 0); \
50447 uint32x4_t __rev2_508; __rev2_508 = __builtin_shufflevector(__s2_508, __s2_508, 3, 2, 1, 0); \
50448 __ret_508 = __rev0_508 - __noswap_vmull_u32(__rev1_508, __noswap_splat_laneq_u32(__rev2_508, __p3_508)); \
50449 __ret_508 = __builtin_shufflevector(__ret_508, __ret_508, 1, 0); \
50450 __ret_508; \
50451})
4957850452#endif
4957950453
49580__ai uint64x1_t vcgtz_s64(int64x1_t __p0) {
49581 uint64x1_t __ret;
49582 __ret = (uint64x1_t) __builtin_neon_vcgtz_v((int8x8_t)__p0, 19);
49583 return __ret;
49584}
4958550454#ifdef __LITTLE_ENDIAN__
49586__ai uint16x4_t vcgtz_s16(int16x4_t __p0) {
49587 uint16x4_t __ret;
49588 __ret = (uint16x4_t) __builtin_neon_vcgtz_v((int8x8_t)__p0, 17);
49589 return __ret;
49590}
50455#define vmlsl_laneq_u16(__p0_509, __p1_509, __p2_509, __p3_509) __extension__ ({ \
50456 uint32x4_t __ret_509; \
50457 uint32x4_t __s0_509 = __p0_509; \
50458 uint16x4_t __s1_509 = __p1_509; \
50459 uint16x8_t __s2_509 = __p2_509; \
50460 __ret_509 = __s0_509 - vmull_u16(__s1_509, splat_laneq_u16(__s2_509, __p3_509)); \
50461 __ret_509; \
50462})
4959150463#else
49592__ai uint16x4_t vcgtz_s16(int16x4_t __p0) {
49593 uint16x4_t __ret;
49594 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
49595 __ret = (uint16x4_t) __builtin_neon_vcgtz_v((int8x8_t)__rev0, 17);
49596 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
49597 return __ret;
49598}
50464#define vmlsl_laneq_u16(__p0_510, __p1_510, __p2_510, __p3_510) __extension__ ({ \
50465 uint32x4_t __ret_510; \
50466 uint32x4_t __s0_510 = __p0_510; \
50467 uint16x4_t __s1_510 = __p1_510; \
50468 uint16x8_t __s2_510 = __p2_510; \
50469 uint32x4_t __rev0_510; __rev0_510 = __builtin_shufflevector(__s0_510, __s0_510, 3, 2, 1, 0); \
50470 uint16x4_t __rev1_510; __rev1_510 = __builtin_shufflevector(__s1_510, __s1_510, 3, 2, 1, 0); \
50471 uint16x8_t __rev2_510; __rev2_510 = __builtin_shufflevector(__s2_510, __s2_510, 7, 6, 5, 4, 3, 2, 1, 0); \
50472 __ret_510 = __rev0_510 - __noswap_vmull_u16(__rev1_510, __noswap_splat_laneq_u16(__rev2_510, __p3_510)); \
50473 __ret_510 = __builtin_shufflevector(__ret_510, __ret_510, 3, 2, 1, 0); \
50474 __ret_510; \
50475})
50476#endif
50477
50478#ifdef __LITTLE_ENDIAN__
50479#define vmlsl_laneq_s32(__p0_511, __p1_511, __p2_511, __p3_511) __extension__ ({ \
50480 int64x2_t __ret_511; \
50481 int64x2_t __s0_511 = __p0_511; \
50482 int32x2_t __s1_511 = __p1_511; \
50483 int32x4_t __s2_511 = __p2_511; \
50484 __ret_511 = __s0_511 - vmull_s32(__s1_511, splat_laneq_s32(__s2_511, __p3_511)); \
50485 __ret_511; \
50486})
50487#else
50488#define vmlsl_laneq_s32(__p0_512, __p1_512, __p2_512, __p3_512) __extension__ ({ \
50489 int64x2_t __ret_512; \
50490 int64x2_t __s0_512 = __p0_512; \
50491 int32x2_t __s1_512 = __p1_512; \
50492 int32x4_t __s2_512 = __p2_512; \
50493 int64x2_t __rev0_512; __rev0_512 = __builtin_shufflevector(__s0_512, __s0_512, 1, 0); \
50494 int32x2_t __rev1_512; __rev1_512 = __builtin_shufflevector(__s1_512, __s1_512, 1, 0); \
50495 int32x4_t __rev2_512; __rev2_512 = __builtin_shufflevector(__s2_512, __s2_512, 3, 2, 1, 0); \
50496 __ret_512 = __rev0_512 - __noswap_vmull_s32(__rev1_512, __noswap_splat_laneq_s32(__rev2_512, __p3_512)); \
50497 __ret_512 = __builtin_shufflevector(__ret_512, __ret_512, 1, 0); \
50498 __ret_512; \
50499})
4959950500#endif
4960050501
49601__ai uint64_t vcgtzd_s64(int64_t __p0) {
49602 uint64_t __ret;
49603 __ret = (uint64_t) __builtin_neon_vcgtzd_s64(__p0);
49604 return __ret;
49605}
49606__ai uint64_t vcgtzd_f64(float64_t __p0) {
49607 uint64_t __ret;
49608 __ret = (uint64_t) __builtin_neon_vcgtzd_f64(__p0);
49609 return __ret;
49610}
49611__ai uint32_t vcgtzs_f32(float32_t __p0) {
49612 uint32_t __ret;
49613 __ret = (uint32_t) __builtin_neon_vcgtzs_f32(__p0);
49614 return __ret;
49615}
4961650502#ifdef __LITTLE_ENDIAN__
49617__ai uint64x2_t vcleq_u64(uint64x2_t __p0, uint64x2_t __p1) {
49618 uint64x2_t __ret;
49619 __ret = (uint64x2_t)(__p0 <= __p1);
49620 return __ret;
49621}
50503#define vmlsl_laneq_s16(__p0_513, __p1_513, __p2_513, __p3_513) __extension__ ({ \
50504 int32x4_t __ret_513; \
50505 int32x4_t __s0_513 = __p0_513; \
50506 int16x4_t __s1_513 = __p1_513; \
50507 int16x8_t __s2_513 = __p2_513; \
50508 __ret_513 = __s0_513 - vmull_s16(__s1_513, splat_laneq_s16(__s2_513, __p3_513)); \
50509 __ret_513; \
50510})
4962250511#else
49623__ai uint64x2_t vcleq_u64(uint64x2_t __p0, uint64x2_t __p1) {
49624 uint64x2_t __ret;
49625 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49626 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
49627 __ret = (uint64x2_t)(__rev0 <= __rev1);
49628 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
49629 return __ret;
49630}
50512#define vmlsl_laneq_s16(__p0_514, __p1_514, __p2_514, __p3_514) __extension__ ({ \
50513 int32x4_t __ret_514; \
50514 int32x4_t __s0_514 = __p0_514; \
50515 int16x4_t __s1_514 = __p1_514; \
50516 int16x8_t __s2_514 = __p2_514; \
50517 int32x4_t __rev0_514; __rev0_514 = __builtin_shufflevector(__s0_514, __s0_514, 3, 2, 1, 0); \
50518 int16x4_t __rev1_514; __rev1_514 = __builtin_shufflevector(__s1_514, __s1_514, 3, 2, 1, 0); \
50519 int16x8_t __rev2_514; __rev2_514 = __builtin_shufflevector(__s2_514, __s2_514, 7, 6, 5, 4, 3, 2, 1, 0); \
50520 __ret_514 = __rev0_514 - __noswap_vmull_s16(__rev1_514, __noswap_splat_laneq_s16(__rev2_514, __p3_514)); \
50521 __ret_514 = __builtin_shufflevector(__ret_514, __ret_514, 3, 2, 1, 0); \
50522 __ret_514; \
50523})
4963150524#endif
4963250525
50526__ai poly64x1_t vmov_n_p64(poly64_t __p0) {
50527 poly64x1_t __ret;
50528 __ret = (poly64x1_t) {__p0};
50529 return __ret;
50530}
4963350531#ifdef __LITTLE_ENDIAN__
49634__ai uint64x2_t vcleq_f64(float64x2_t __p0, float64x2_t __p1) {
49635 uint64x2_t __ret;
49636 __ret = (uint64x2_t)(__p0 <= __p1);
50532__ai poly64x2_t vmovq_n_p64(poly64_t __p0) {
50533 poly64x2_t __ret;
50534 __ret = (poly64x2_t) {__p0, __p0};
4963750535 return __ret;
4963850536}
4963950537#else
49640__ai uint64x2_t vcleq_f64(float64x2_t __p0, float64x2_t __p1) {
49641 uint64x2_t __ret;
49642 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49643 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
49644 __ret = (uint64x2_t)(__rev0 <= __rev1);
50538__ai poly64x2_t vmovq_n_p64(poly64_t __p0) {
50539 poly64x2_t __ret;
50540 __ret = (poly64x2_t) {__p0, __p0};
4964550541 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4964650542 return __ret;
4964750543}
4964850544#endif
4964950545
4965050546#ifdef __LITTLE_ENDIAN__
49651__ai uint64x2_t vcleq_s64(int64x2_t __p0, int64x2_t __p1) {
49652 uint64x2_t __ret;
49653 __ret = (uint64x2_t)(__p0 <= __p1);
50547__ai float64x2_t vmovq_n_f64(float64_t __p0) {
50548 float64x2_t __ret;
50549 __ret = (float64x2_t) {__p0, __p0};
4965450550 return __ret;
4965550551}
4965650552#else
49657__ai uint64x2_t vcleq_s64(int64x2_t __p0, int64x2_t __p1) {
49658 uint64x2_t __ret;
49659 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49660 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
49661 __ret = (uint64x2_t)(__rev0 <= __rev1);
50553__ai float64x2_t vmovq_n_f64(float64_t __p0) {
50554 float64x2_t __ret;
50555 __ret = (float64x2_t) {__p0, __p0};
4966250556 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4966350557 return __ret;
4966450558}
4966550559#endif
4966650560
49667__ai uint64x1_t vcle_u64(uint64x1_t __p0, uint64x1_t __p1) {
49668 uint64x1_t __ret;
49669 __ret = (uint64x1_t)(__p0 <= __p1);
49670 return __ret;
49671}
49672__ai uint64x1_t vcle_f64(float64x1_t __p0, float64x1_t __p1) {
49673 uint64x1_t __ret;
49674 __ret = (uint64x1_t)(__p0 <= __p1);
49675 return __ret;
49676}
49677__ai uint64x1_t vcle_s64(int64x1_t __p0, int64x1_t __p1) {
49678 uint64x1_t __ret;
49679 __ret = (uint64x1_t)(__p0 <= __p1);
49680 return __ret;
49681}
49682__ai uint64_t vcled_u64(uint64_t __p0, uint64_t __p1) {
49683 uint64_t __ret;
49684 __ret = (uint64_t) __builtin_neon_vcled_u64(__p0, __p1);
50561__ai float64x1_t vmov_n_f64(float64_t __p0) {
50562 float64x1_t __ret;
50563 __ret = (float64x1_t) {__p0};
4968550564 return __ret;
4968650565}
49687__ai uint64_t vcled_s64(int64_t __p0, int64_t __p1) {
49688 uint64_t __ret;
49689 __ret = (uint64_t) __builtin_neon_vcled_s64(__p0, __p1);
49690 return __ret;
50566#ifdef __LITTLE_ENDIAN__
50567__ai uint16x8_t vmovl_high_u8(uint8x16_t __p0_515) {
50568 uint16x8_t __ret_515;
50569 uint8x8_t __a1_515 = vget_high_u8(__p0_515);
50570 __ret_515 = (uint16x8_t)(vshll_n_u8(__a1_515, 0));
50571 return __ret_515;
4969150572}
49692__ai uint64_t vcled_f64(float64_t __p0, float64_t __p1) {
49693 uint64_t __ret;
49694 __ret = (uint64_t) __builtin_neon_vcled_f64(__p0, __p1);
49695 return __ret;
50573#else
50574__ai uint16x8_t vmovl_high_u8(uint8x16_t __p0_516) {
50575 uint16x8_t __ret_516;
50576 uint8x16_t __rev0_516; __rev0_516 = __builtin_shufflevector(__p0_516, __p0_516, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
50577 uint8x8_t __a1_516 = __noswap_vget_high_u8(__rev0_516);
50578 __ret_516 = (uint16x8_t)(__noswap_vshll_n_u8(__a1_516, 0));
50579 __ret_516 = __builtin_shufflevector(__ret_516, __ret_516, 7, 6, 5, 4, 3, 2, 1, 0);
50580 return __ret_516;
4969650581}
49697__ai uint32_t vcles_f32(float32_t __p0, float32_t __p1) {
49698 uint32_t __ret;
49699 __ret = (uint32_t) __builtin_neon_vcles_f32(__p0, __p1);
49700 return __ret;
50582__ai uint16x8_t __noswap_vmovl_high_u8(uint8x16_t __p0_517) {
50583 uint16x8_t __ret_517;
50584 uint8x8_t __a1_517 = __noswap_vget_high_u8(__p0_517);
50585 __ret_517 = (uint16x8_t)(__noswap_vshll_n_u8(__a1_517, 0));
50586 return __ret_517;
4970150587}
50588#endif
50589
4970250590#ifdef __LITTLE_ENDIAN__
49703__ai uint8x16_t vclezq_s8(int8x16_t __p0) {
49704 uint8x16_t __ret;
49705 __ret = (uint8x16_t) __builtin_neon_vclezq_v((int8x16_t)__p0, 48);
49706 return __ret;
50591__ai uint64x2_t vmovl_high_u32(uint32x4_t __p0_518) {
50592 uint64x2_t __ret_518;
50593 uint32x2_t __a1_518 = vget_high_u32(__p0_518);
50594 __ret_518 = (uint64x2_t)(vshll_n_u32(__a1_518, 0));
50595 return __ret_518;
4970750596}
4970850597#else
49709__ai uint8x16_t vclezq_s8(int8x16_t __p0) {
49710 uint8x16_t __ret;
49711 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
49712 __ret = (uint8x16_t) __builtin_neon_vclezq_v((int8x16_t)__rev0, 48);
49713 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
49714 return __ret;
50598__ai uint64x2_t vmovl_high_u32(uint32x4_t __p0_519) {
50599 uint64x2_t __ret_519;
50600 uint32x4_t __rev0_519; __rev0_519 = __builtin_shufflevector(__p0_519, __p0_519, 3, 2, 1, 0);
50601 uint32x2_t __a1_519 = __noswap_vget_high_u32(__rev0_519);
50602 __ret_519 = (uint64x2_t)(__noswap_vshll_n_u32(__a1_519, 0));
50603 __ret_519 = __builtin_shufflevector(__ret_519, __ret_519, 1, 0);
50604 return __ret_519;
50605}
50606__ai uint64x2_t __noswap_vmovl_high_u32(uint32x4_t __p0_520) {
50607 uint64x2_t __ret_520;
50608 uint32x2_t __a1_520 = __noswap_vget_high_u32(__p0_520);
50609 __ret_520 = (uint64x2_t)(__noswap_vshll_n_u32(__a1_520, 0));
50610 return __ret_520;
4971550611}
4971650612#endif
4971750613
4971850614#ifdef __LITTLE_ENDIAN__
49719__ai uint64x2_t vclezq_f64(float64x2_t __p0) {
49720 uint64x2_t __ret;
49721 __ret = (uint64x2_t) __builtin_neon_vclezq_v((int8x16_t)__p0, 51);
49722 return __ret;
50615__ai uint32x4_t vmovl_high_u16(uint16x8_t __p0_521) {
50616 uint32x4_t __ret_521;
50617 uint16x4_t __a1_521 = vget_high_u16(__p0_521);
50618 __ret_521 = (uint32x4_t)(vshll_n_u16(__a1_521, 0));
50619 return __ret_521;
4972350620}
4972450621#else
49725__ai uint64x2_t vclezq_f64(float64x2_t __p0) {
49726 uint64x2_t __ret;
49727 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49728 __ret = (uint64x2_t) __builtin_neon_vclezq_v((int8x16_t)__rev0, 51);
49729 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
49730 return __ret;
50622__ai uint32x4_t vmovl_high_u16(uint16x8_t __p0_522) {
50623 uint32x4_t __ret_522;
50624 uint16x8_t __rev0_522; __rev0_522 = __builtin_shufflevector(__p0_522, __p0_522, 7, 6, 5, 4, 3, 2, 1, 0);
50625 uint16x4_t __a1_522 = __noswap_vget_high_u16(__rev0_522);
50626 __ret_522 = (uint32x4_t)(__noswap_vshll_n_u16(__a1_522, 0));
50627 __ret_522 = __builtin_shufflevector(__ret_522, __ret_522, 3, 2, 1, 0);
50628 return __ret_522;
50629}
50630__ai uint32x4_t __noswap_vmovl_high_u16(uint16x8_t __p0_523) {
50631 uint32x4_t __ret_523;
50632 uint16x4_t __a1_523 = __noswap_vget_high_u16(__p0_523);
50633 __ret_523 = (uint32x4_t)(__noswap_vshll_n_u16(__a1_523, 0));
50634 return __ret_523;
4973150635}
4973250636#endif
4973350637
4973450638#ifdef __LITTLE_ENDIAN__
49735__ai uint32x4_t vclezq_f32(float32x4_t __p0) {
49736 uint32x4_t __ret;
49737 __ret = (uint32x4_t) __builtin_neon_vclezq_v((int8x16_t)__p0, 50);
49738 return __ret;
50639__ai int16x8_t vmovl_high_s8(int8x16_t __p0_524) {
50640 int16x8_t __ret_524;
50641 int8x8_t __a1_524 = vget_high_s8(__p0_524);
50642 __ret_524 = (int16x8_t)(vshll_n_s8(__a1_524, 0));
50643 return __ret_524;
4973950644}
4974050645#else
49741__ai uint32x4_t vclezq_f32(float32x4_t __p0) {
49742 uint32x4_t __ret;
49743 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
49744 __ret = (uint32x4_t) __builtin_neon_vclezq_v((int8x16_t)__rev0, 50);
49745 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
49746 return __ret;
50646__ai int16x8_t vmovl_high_s8(int8x16_t __p0_525) {
50647 int16x8_t __ret_525;
50648 int8x16_t __rev0_525; __rev0_525 = __builtin_shufflevector(__p0_525, __p0_525, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
50649 int8x8_t __a1_525 = __noswap_vget_high_s8(__rev0_525);
50650 __ret_525 = (int16x8_t)(__noswap_vshll_n_s8(__a1_525, 0));
50651 __ret_525 = __builtin_shufflevector(__ret_525, __ret_525, 7, 6, 5, 4, 3, 2, 1, 0);
50652 return __ret_525;
50653}
50654__ai int16x8_t __noswap_vmovl_high_s8(int8x16_t __p0_526) {
50655 int16x8_t __ret_526;
50656 int8x8_t __a1_526 = __noswap_vget_high_s8(__p0_526);
50657 __ret_526 = (int16x8_t)(__noswap_vshll_n_s8(__a1_526, 0));
50658 return __ret_526;
4974750659}
4974850660#endif
4974950661
4975050662#ifdef __LITTLE_ENDIAN__
49751__ai uint32x4_t vclezq_s32(int32x4_t __p0) {
49752 uint32x4_t __ret;
49753 __ret = (uint32x4_t) __builtin_neon_vclezq_v((int8x16_t)__p0, 50);
49754 return __ret;
50663__ai int64x2_t vmovl_high_s32(int32x4_t __p0_527) {
50664 int64x2_t __ret_527;
50665 int32x2_t __a1_527 = vget_high_s32(__p0_527);
50666 __ret_527 = (int64x2_t)(vshll_n_s32(__a1_527, 0));
50667 return __ret_527;
4975550668}
4975650669#else
49757__ai uint32x4_t vclezq_s32(int32x4_t __p0) {
49758 uint32x4_t __ret;
49759 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
49760 __ret = (uint32x4_t) __builtin_neon_vclezq_v((int8x16_t)__rev0, 50);
49761 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
49762 return __ret;
50670__ai int64x2_t vmovl_high_s32(int32x4_t __p0_528) {
50671 int64x2_t __ret_528;
50672 int32x4_t __rev0_528; __rev0_528 = __builtin_shufflevector(__p0_528, __p0_528, 3, 2, 1, 0);
50673 int32x2_t __a1_528 = __noswap_vget_high_s32(__rev0_528);
50674 __ret_528 = (int64x2_t)(__noswap_vshll_n_s32(__a1_528, 0));
50675 __ret_528 = __builtin_shufflevector(__ret_528, __ret_528, 1, 0);
50676 return __ret_528;
50677}
50678__ai int64x2_t __noswap_vmovl_high_s32(int32x4_t __p0_529) {
50679 int64x2_t __ret_529;
50680 int32x2_t __a1_529 = __noswap_vget_high_s32(__p0_529);
50681 __ret_529 = (int64x2_t)(__noswap_vshll_n_s32(__a1_529, 0));
50682 return __ret_529;
4976350683}
4976450684#endif
4976550685
4976650686#ifdef __LITTLE_ENDIAN__
49767__ai uint64x2_t vclezq_s64(int64x2_t __p0) {
49768 uint64x2_t __ret;
49769 __ret = (uint64x2_t) __builtin_neon_vclezq_v((int8x16_t)__p0, 51);
49770 return __ret;
50687__ai int32x4_t vmovl_high_s16(int16x8_t __p0_530) {
50688 int32x4_t __ret_530;
50689 int16x4_t __a1_530 = vget_high_s16(__p0_530);
50690 __ret_530 = (int32x4_t)(vshll_n_s16(__a1_530, 0));
50691 return __ret_530;
4977150692}
4977250693#else
49773__ai uint64x2_t vclezq_s64(int64x2_t __p0) {
49774 uint64x2_t __ret;
49775 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49776 __ret = (uint64x2_t) __builtin_neon_vclezq_v((int8x16_t)__rev0, 51);
49777 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
49778 return __ret;
50694__ai int32x4_t vmovl_high_s16(int16x8_t __p0_531) {
50695 int32x4_t __ret_531;
50696 int16x8_t __rev0_531; __rev0_531 = __builtin_shufflevector(__p0_531, __p0_531, 7, 6, 5, 4, 3, 2, 1, 0);
50697 int16x4_t __a1_531 = __noswap_vget_high_s16(__rev0_531);
50698 __ret_531 = (int32x4_t)(__noswap_vshll_n_s16(__a1_531, 0));
50699 __ret_531 = __builtin_shufflevector(__ret_531, __ret_531, 3, 2, 1, 0);
50700 return __ret_531;
50701}
50702__ai int32x4_t __noswap_vmovl_high_s16(int16x8_t __p0_532) {
50703 int32x4_t __ret_532;
50704 int16x4_t __a1_532 = __noswap_vget_high_s16(__p0_532);
50705 __ret_532 = (int32x4_t)(__noswap_vshll_n_s16(__a1_532, 0));
50706 return __ret_532;
4977950707}
4978050708#endif
4978150709
4978250710#ifdef __LITTLE_ENDIAN__
49783__ai uint16x8_t vclezq_s16(int16x8_t __p0) {
50711__ai uint16x8_t vmovn_high_u32(uint16x4_t __p0, uint32x4_t __p1) {
4978450712 uint16x8_t __ret;
49785 __ret = (uint16x8_t) __builtin_neon_vclezq_v((int8x16_t)__p0, 49);
50713 __ret = vcombine_u16(__p0, vmovn_u32(__p1));
4978650714 return __ret;
4978750715}
4978850716#else
49789__ai uint16x8_t vclezq_s16(int16x8_t __p0) {
50717__ai uint16x8_t vmovn_high_u32(uint16x4_t __p0, uint32x4_t __p1) {
4979050718 uint16x8_t __ret;
49791 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
49792 __ret = (uint16x8_t) __builtin_neon_vclezq_v((int8x16_t)__rev0, 49);
50719 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
50720 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
50721 __ret = __noswap_vcombine_u16(__rev0, __noswap_vmovn_u32(__rev1));
4979350722 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
4979450723 return __ret;
4979550724}
4979650725#endif
4979750726
4979850727#ifdef __LITTLE_ENDIAN__
49799__ai uint8x8_t vclez_s8(int8x8_t __p0) {
49800 uint8x8_t __ret;
49801 __ret = (uint8x8_t) __builtin_neon_vclez_v((int8x8_t)__p0, 16);
50728__ai uint32x4_t vmovn_high_u64(uint32x2_t __p0, uint64x2_t __p1) {
50729 uint32x4_t __ret;
50730 __ret = vcombine_u32(__p0, vmovn_u64(__p1));
4980250731 return __ret;
4980350732}
4980450733#else
49805__ai uint8x8_t vclez_s8(int8x8_t __p0) {
49806 uint8x8_t __ret;
49807 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
49808 __ret = (uint8x8_t) __builtin_neon_vclez_v((int8x8_t)__rev0, 16);
49809 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
50734__ai uint32x4_t vmovn_high_u64(uint32x2_t __p0, uint64x2_t __p1) {
50735 uint32x4_t __ret;
50736 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
50737 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
50738 __ret = __noswap_vcombine_u32(__rev0, __noswap_vmovn_u64(__rev1));
50739 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
4981050740 return __ret;
4981150741}
4981250742#endif
4981350743
49814__ai uint64x1_t vclez_f64(float64x1_t __p0) {
49815 uint64x1_t __ret;
49816 __ret = (uint64x1_t) __builtin_neon_vclez_v((int8x8_t)__p0, 19);
49817 return __ret;
49818}
4981950744#ifdef __LITTLE_ENDIAN__
49820__ai uint32x2_t vclez_f32(float32x2_t __p0) {
49821 uint32x2_t __ret;
49822 __ret = (uint32x2_t) __builtin_neon_vclez_v((int8x8_t)__p0, 18);
50745__ai uint8x16_t vmovn_high_u16(uint8x8_t __p0, uint16x8_t __p1) {
50746 uint8x16_t __ret;
50747 __ret = vcombine_u8(__p0, vmovn_u16(__p1));
4982350748 return __ret;
4982450749}
4982550750#else
49826__ai uint32x2_t vclez_f32(float32x2_t __p0) {
49827 uint32x2_t __ret;
49828 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49829 __ret = (uint32x2_t) __builtin_neon_vclez_v((int8x8_t)__rev0, 18);
49830 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
50751__ai uint8x16_t vmovn_high_u16(uint8x8_t __p0, uint16x8_t __p1) {
50752 uint8x16_t __ret;
50753 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
50754 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
50755 __ret = __noswap_vcombine_u8(__rev0, __noswap_vmovn_u16(__rev1));
50756 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
4983150757 return __ret;
4983250758}
4983350759#endif
4983450760
4983550761#ifdef __LITTLE_ENDIAN__
49836__ai uint32x2_t vclez_s32(int32x2_t __p0) {
49837 uint32x2_t __ret;
49838 __ret = (uint32x2_t) __builtin_neon_vclez_v((int8x8_t)__p0, 18);
50762__ai int16x8_t vmovn_high_s32(int16x4_t __p0, int32x4_t __p1) {
50763 int16x8_t __ret;
50764 __ret = vcombine_s16(__p0, vmovn_s32(__p1));
4983950765 return __ret;
4984050766}
4984150767#else
49842__ai uint32x2_t vclez_s32(int32x2_t __p0) {
49843 uint32x2_t __ret;
49844 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49845 __ret = (uint32x2_t) __builtin_neon_vclez_v((int8x8_t)__rev0, 18);
49846 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
50768__ai int16x8_t vmovn_high_s32(int16x4_t __p0, int32x4_t __p1) {
50769 int16x8_t __ret;
50770 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
50771 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
50772 __ret = __noswap_vcombine_s16(__rev0, __noswap_vmovn_s32(__rev1));
50773 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
4984750774 return __ret;
4984850775}
4984950776#endif
4985050777
49851__ai uint64x1_t vclez_s64(int64x1_t __p0) {
49852 uint64x1_t __ret;
49853 __ret = (uint64x1_t) __builtin_neon_vclez_v((int8x8_t)__p0, 19);
49854 return __ret;
49855}
4985650778#ifdef __LITTLE_ENDIAN__
49857__ai uint16x4_t vclez_s16(int16x4_t __p0) {
49858 uint16x4_t __ret;
49859 __ret = (uint16x4_t) __builtin_neon_vclez_v((int8x8_t)__p0, 17);
50779__ai int32x4_t vmovn_high_s64(int32x2_t __p0, int64x2_t __p1) {
50780 int32x4_t __ret;
50781 __ret = vcombine_s32(__p0, vmovn_s64(__p1));
4986050782 return __ret;
4986150783}
4986250784#else
49863__ai uint16x4_t vclez_s16(int16x4_t __p0) {
49864 uint16x4_t __ret;
49865 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
49866 __ret = (uint16x4_t) __builtin_neon_vclez_v((int8x8_t)__rev0, 17);
50785__ai int32x4_t vmovn_high_s64(int32x2_t __p0, int64x2_t __p1) {
50786 int32x4_t __ret;
50787 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
50788 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
50789 __ret = __noswap_vcombine_s32(__rev0, __noswap_vmovn_s64(__rev1));
4986750790 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
4986850791 return __ret;
4986950792}
4987050793#endif
4987150794
49872__ai uint64_t vclezd_s64(int64_t __p0) {
49873 uint64_t __ret;
49874 __ret = (uint64_t) __builtin_neon_vclezd_s64(__p0);
49875 return __ret;
49876}
49877__ai uint64_t vclezd_f64(float64_t __p0) {
49878 uint64_t __ret;
49879 __ret = (uint64_t) __builtin_neon_vclezd_f64(__p0);
49880 return __ret;
49881}
49882__ai uint32_t vclezs_f32(float32_t __p0) {
49883 uint32_t __ret;
49884 __ret = (uint32_t) __builtin_neon_vclezs_f32(__p0);
49885 return __ret;
49886}
4988750795#ifdef __LITTLE_ENDIAN__
49888__ai uint64x2_t vcltq_u64(uint64x2_t __p0, uint64x2_t __p1) {
49889 uint64x2_t __ret;
49890 __ret = (uint64x2_t)(__p0 < __p1);
50796__ai int8x16_t vmovn_high_s16(int8x8_t __p0, int16x8_t __p1) {
50797 int8x16_t __ret;
50798 __ret = vcombine_s8(__p0, vmovn_s16(__p1));
4989150799 return __ret;
4989250800}
4989350801#else
49894__ai uint64x2_t vcltq_u64(uint64x2_t __p0, uint64x2_t __p1) {
49895 uint64x2_t __ret;
49896 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49897 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
49898 __ret = (uint64x2_t)(__rev0 < __rev1);
49899 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
50802__ai int8x16_t vmovn_high_s16(int8x8_t __p0, int16x8_t __p1) {
50803 int8x16_t __ret;
50804 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
50805 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
50806 __ret = __noswap_vcombine_s8(__rev0, __noswap_vmovn_s16(__rev1));
50807 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
4990050808 return __ret;
4990150809}
4990250810#endif
4990350811
4990450812#ifdef __LITTLE_ENDIAN__
49905__ai uint64x2_t vcltq_f64(float64x2_t __p0, float64x2_t __p1) {
49906 uint64x2_t __ret;
49907 __ret = (uint64x2_t)(__p0 < __p1);
50813__ai float64x2_t vmulq_f64(float64x2_t __p0, float64x2_t __p1) {
50814 float64x2_t __ret;
50815 __ret = __p0 * __p1;
4990850816 return __ret;
4990950817}
4991050818#else
49911__ai uint64x2_t vcltq_f64(float64x2_t __p0, float64x2_t __p1) {
49912 uint64x2_t __ret;
50819__ai float64x2_t vmulq_f64(float64x2_t __p0, float64x2_t __p1) {
50820 float64x2_t __ret;
4991350821 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
4991450822 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
49915 __ret = (uint64x2_t)(__rev0 < __rev1);
50823 __ret = __rev0 * __rev1;
4991650824 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4991750825 return __ret;
4991850826}
4991950827#endif
4992050828
49921#ifdef __LITTLE_ENDIAN__
49922__ai uint64x2_t vcltq_s64(int64x2_t __p0, int64x2_t __p1) {
49923 uint64x2_t __ret;
49924 __ret = (uint64x2_t)(__p0 < __p1);
50829__ai float64x1_t vmul_f64(float64x1_t __p0, float64x1_t __p1) {
50830 float64x1_t __ret;
50831 __ret = __p0 * __p1;
4992550832 return __ret;
4992650833}
50834#define vmuld_lane_f64(__p0_533, __p1_533, __p2_533) __extension__ ({ \
50835 float64_t __ret_533; \
50836 float64_t __s0_533 = __p0_533; \
50837 float64x1_t __s1_533 = __p1_533; \
50838 __ret_533 = __s0_533 * vget_lane_f64(__s1_533, __p2_533); \
50839 __ret_533; \
50840})
50841#ifdef __LITTLE_ENDIAN__
50842#define vmuls_lane_f32(__p0_534, __p1_534, __p2_534) __extension__ ({ \
50843 float32_t __ret_534; \
50844 float32_t __s0_534 = __p0_534; \
50845 float32x2_t __s1_534 = __p1_534; \
50846 __ret_534 = __s0_534 * vget_lane_f32(__s1_534, __p2_534); \
50847 __ret_534; \
50848})
4992750849#else
49928__ai uint64x2_t vcltq_s64(int64x2_t __p0, int64x2_t __p1) {
49929 uint64x2_t __ret;
49930 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49931 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
49932 __ret = (uint64x2_t)(__rev0 < __rev1);
49933 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
49934 return __ret;
49935}
50850#define vmuls_lane_f32(__p0_535, __p1_535, __p2_535) __extension__ ({ \
50851 float32_t __ret_535; \
50852 float32_t __s0_535 = __p0_535; \
50853 float32x2_t __s1_535 = __p1_535; \
50854 float32x2_t __rev1_535; __rev1_535 = __builtin_shufflevector(__s1_535, __s1_535, 1, 0); \
50855 __ret_535 = __s0_535 * __noswap_vget_lane_f32(__rev1_535, __p2_535); \
50856 __ret_535; \
50857})
4993650858#endif
4993750859
49938__ai uint64x1_t vclt_u64(uint64x1_t __p0, uint64x1_t __p1) {
49939 uint64x1_t __ret;
49940 __ret = (uint64x1_t)(__p0 < __p1);
49941 return __ret;
49942}
49943__ai uint64x1_t vclt_f64(float64x1_t __p0, float64x1_t __p1) {
49944 uint64x1_t __ret;
49945 __ret = (uint64x1_t)(__p0 < __p1);
49946 return __ret;
49947}
49948__ai uint64x1_t vclt_s64(int64x1_t __p0, int64x1_t __p1) {
49949 uint64x1_t __ret;
49950 __ret = (uint64x1_t)(__p0 < __p1);
50860#define vmul_lane_f64(__p0, __p1, __p2) __extension__ ({ \
50861 float64x1_t __ret; \
50862 float64x1_t __s0 = __p0; \
50863 float64x1_t __s1 = __p1; \
50864 __ret = (float64x1_t) __builtin_neon_vmul_lane_v((int8x8_t)__s0, (int8x8_t)__s1, __p2, 10); \
50865 __ret; \
50866})
50867#ifdef __LITTLE_ENDIAN__
50868#define vmulq_lane_f64(__p0_536, __p1_536, __p2_536) __extension__ ({ \
50869 float64x2_t __ret_536; \
50870 float64x2_t __s0_536 = __p0_536; \
50871 float64x1_t __s1_536 = __p1_536; \
50872 __ret_536 = __s0_536 * splatq_lane_f64(__s1_536, __p2_536); \
50873 __ret_536; \
50874})
50875#else
50876#define vmulq_lane_f64(__p0_537, __p1_537, __p2_537) __extension__ ({ \
50877 float64x2_t __ret_537; \
50878 float64x2_t __s0_537 = __p0_537; \
50879 float64x1_t __s1_537 = __p1_537; \
50880 float64x2_t __rev0_537; __rev0_537 = __builtin_shufflevector(__s0_537, __s0_537, 1, 0); \
50881 __ret_537 = __rev0_537 * __noswap_splatq_lane_f64(__s1_537, __p2_537); \
50882 __ret_537 = __builtin_shufflevector(__ret_537, __ret_537, 1, 0); \
50883 __ret_537; \
50884})
50885#endif
50886
50887#ifdef __LITTLE_ENDIAN__
50888#define vmuld_laneq_f64(__p0_538, __p1_538, __p2_538) __extension__ ({ \
50889 float64_t __ret_538; \
50890 float64_t __s0_538 = __p0_538; \
50891 float64x2_t __s1_538 = __p1_538; \
50892 __ret_538 = __s0_538 * vgetq_lane_f64(__s1_538, __p2_538); \
50893 __ret_538; \
50894})
50895#else
50896#define vmuld_laneq_f64(__p0_539, __p1_539, __p2_539) __extension__ ({ \
50897 float64_t __ret_539; \
50898 float64_t __s0_539 = __p0_539; \
50899 float64x2_t __s1_539 = __p1_539; \
50900 float64x2_t __rev1_539; __rev1_539 = __builtin_shufflevector(__s1_539, __s1_539, 1, 0); \
50901 __ret_539 = __s0_539 * __noswap_vgetq_lane_f64(__rev1_539, __p2_539); \
50902 __ret_539; \
50903})
50904#endif
50905
50906#ifdef __LITTLE_ENDIAN__
50907#define vmuls_laneq_f32(__p0_540, __p1_540, __p2_540) __extension__ ({ \
50908 float32_t __ret_540; \
50909 float32_t __s0_540 = __p0_540; \
50910 float32x4_t __s1_540 = __p1_540; \
50911 __ret_540 = __s0_540 * vgetq_lane_f32(__s1_540, __p2_540); \
50912 __ret_540; \
50913})
50914#else
50915#define vmuls_laneq_f32(__p0_541, __p1_541, __p2_541) __extension__ ({ \
50916 float32_t __ret_541; \
50917 float32_t __s0_541 = __p0_541; \
50918 float32x4_t __s1_541 = __p1_541; \
50919 float32x4_t __rev1_541; __rev1_541 = __builtin_shufflevector(__s1_541, __s1_541, 3, 2, 1, 0); \
50920 __ret_541 = __s0_541 * __noswap_vgetq_lane_f32(__rev1_541, __p2_541); \
50921 __ret_541; \
50922})
50923#endif
50924
50925#ifdef __LITTLE_ENDIAN__
50926#define vmul_laneq_f64(__p0, __p1, __p2) __extension__ ({ \
50927 float64x1_t __ret; \
50928 float64x1_t __s0 = __p0; \
50929 float64x2_t __s1 = __p1; \
50930 __ret = (float64x1_t) __builtin_neon_vmul_laneq_v((int8x8_t)__s0, (int8x16_t)__s1, __p2, 10); \
50931 __ret; \
50932})
50933#else
50934#define vmul_laneq_f64(__p0, __p1, __p2) __extension__ ({ \
50935 float64x1_t __ret; \
50936 float64x1_t __s0 = __p0; \
50937 float64x2_t __s1 = __p1; \
50938 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
50939 __ret = (float64x1_t) __builtin_neon_vmul_laneq_v((int8x8_t)__s0, (int8x16_t)__rev1, __p2, 10); \
50940 __ret; \
50941})
50942#endif
50943
50944#ifdef __LITTLE_ENDIAN__
50945#define vmulq_laneq_u32(__p0_542, __p1_542, __p2_542) __extension__ ({ \
50946 uint32x4_t __ret_542; \
50947 uint32x4_t __s0_542 = __p0_542; \
50948 uint32x4_t __s1_542 = __p1_542; \
50949 __ret_542 = __s0_542 * splatq_laneq_u32(__s1_542, __p2_542); \
50950 __ret_542; \
50951})
50952#else
50953#define vmulq_laneq_u32(__p0_543, __p1_543, __p2_543) __extension__ ({ \
50954 uint32x4_t __ret_543; \
50955 uint32x4_t __s0_543 = __p0_543; \
50956 uint32x4_t __s1_543 = __p1_543; \
50957 uint32x4_t __rev0_543; __rev0_543 = __builtin_shufflevector(__s0_543, __s0_543, 3, 2, 1, 0); \
50958 uint32x4_t __rev1_543; __rev1_543 = __builtin_shufflevector(__s1_543, __s1_543, 3, 2, 1, 0); \
50959 __ret_543 = __rev0_543 * __noswap_splatq_laneq_u32(__rev1_543, __p2_543); \
50960 __ret_543 = __builtin_shufflevector(__ret_543, __ret_543, 3, 2, 1, 0); \
50961 __ret_543; \
50962})
50963#endif
50964
50965#ifdef __LITTLE_ENDIAN__
50966#define vmulq_laneq_u16(__p0_544, __p1_544, __p2_544) __extension__ ({ \
50967 uint16x8_t __ret_544; \
50968 uint16x8_t __s0_544 = __p0_544; \
50969 uint16x8_t __s1_544 = __p1_544; \
50970 __ret_544 = __s0_544 * splatq_laneq_u16(__s1_544, __p2_544); \
50971 __ret_544; \
50972})
50973#else
50974#define vmulq_laneq_u16(__p0_545, __p1_545, __p2_545) __extension__ ({ \
50975 uint16x8_t __ret_545; \
50976 uint16x8_t __s0_545 = __p0_545; \
50977 uint16x8_t __s1_545 = __p1_545; \
50978 uint16x8_t __rev0_545; __rev0_545 = __builtin_shufflevector(__s0_545, __s0_545, 7, 6, 5, 4, 3, 2, 1, 0); \
50979 uint16x8_t __rev1_545; __rev1_545 = __builtin_shufflevector(__s1_545, __s1_545, 7, 6, 5, 4, 3, 2, 1, 0); \
50980 __ret_545 = __rev0_545 * __noswap_splatq_laneq_u16(__rev1_545, __p2_545); \
50981 __ret_545 = __builtin_shufflevector(__ret_545, __ret_545, 7, 6, 5, 4, 3, 2, 1, 0); \
50982 __ret_545; \
50983})
50984#endif
50985
50986#ifdef __LITTLE_ENDIAN__
50987#define vmulq_laneq_f64(__p0_546, __p1_546, __p2_546) __extension__ ({ \
50988 float64x2_t __ret_546; \
50989 float64x2_t __s0_546 = __p0_546; \
50990 float64x2_t __s1_546 = __p1_546; \
50991 __ret_546 = __s0_546 * splatq_laneq_f64(__s1_546, __p2_546); \
50992 __ret_546; \
50993})
50994#else
50995#define vmulq_laneq_f64(__p0_547, __p1_547, __p2_547) __extension__ ({ \
50996 float64x2_t __ret_547; \
50997 float64x2_t __s0_547 = __p0_547; \
50998 float64x2_t __s1_547 = __p1_547; \
50999 float64x2_t __rev0_547; __rev0_547 = __builtin_shufflevector(__s0_547, __s0_547, 1, 0); \
51000 float64x2_t __rev1_547; __rev1_547 = __builtin_shufflevector(__s1_547, __s1_547, 1, 0); \
51001 __ret_547 = __rev0_547 * __noswap_splatq_laneq_f64(__rev1_547, __p2_547); \
51002 __ret_547 = __builtin_shufflevector(__ret_547, __ret_547, 1, 0); \
51003 __ret_547; \
51004})
51005#endif
51006
51007#ifdef __LITTLE_ENDIAN__
51008#define vmulq_laneq_f32(__p0_548, __p1_548, __p2_548) __extension__ ({ \
51009 float32x4_t __ret_548; \
51010 float32x4_t __s0_548 = __p0_548; \
51011 float32x4_t __s1_548 = __p1_548; \
51012 __ret_548 = __s0_548 * splatq_laneq_f32(__s1_548, __p2_548); \
51013 __ret_548; \
51014})
51015#else
51016#define vmulq_laneq_f32(__p0_549, __p1_549, __p2_549) __extension__ ({ \
51017 float32x4_t __ret_549; \
51018 float32x4_t __s0_549 = __p0_549; \
51019 float32x4_t __s1_549 = __p1_549; \
51020 float32x4_t __rev0_549; __rev0_549 = __builtin_shufflevector(__s0_549, __s0_549, 3, 2, 1, 0); \
51021 float32x4_t __rev1_549; __rev1_549 = __builtin_shufflevector(__s1_549, __s1_549, 3, 2, 1, 0); \
51022 __ret_549 = __rev0_549 * __noswap_splatq_laneq_f32(__rev1_549, __p2_549); \
51023 __ret_549 = __builtin_shufflevector(__ret_549, __ret_549, 3, 2, 1, 0); \
51024 __ret_549; \
51025})
51026#endif
51027
51028#ifdef __LITTLE_ENDIAN__
51029#define vmulq_laneq_s32(__p0_550, __p1_550, __p2_550) __extension__ ({ \
51030 int32x4_t __ret_550; \
51031 int32x4_t __s0_550 = __p0_550; \
51032 int32x4_t __s1_550 = __p1_550; \
51033 __ret_550 = __s0_550 * splatq_laneq_s32(__s1_550, __p2_550); \
51034 __ret_550; \
51035})
51036#else
51037#define vmulq_laneq_s32(__p0_551, __p1_551, __p2_551) __extension__ ({ \
51038 int32x4_t __ret_551; \
51039 int32x4_t __s0_551 = __p0_551; \
51040 int32x4_t __s1_551 = __p1_551; \
51041 int32x4_t __rev0_551; __rev0_551 = __builtin_shufflevector(__s0_551, __s0_551, 3, 2, 1, 0); \
51042 int32x4_t __rev1_551; __rev1_551 = __builtin_shufflevector(__s1_551, __s1_551, 3, 2, 1, 0); \
51043 __ret_551 = __rev0_551 * __noswap_splatq_laneq_s32(__rev1_551, __p2_551); \
51044 __ret_551 = __builtin_shufflevector(__ret_551, __ret_551, 3, 2, 1, 0); \
51045 __ret_551; \
51046})
51047#endif
51048
51049#ifdef __LITTLE_ENDIAN__
51050#define vmulq_laneq_s16(__p0_552, __p1_552, __p2_552) __extension__ ({ \
51051 int16x8_t __ret_552; \
51052 int16x8_t __s0_552 = __p0_552; \
51053 int16x8_t __s1_552 = __p1_552; \
51054 __ret_552 = __s0_552 * splatq_laneq_s16(__s1_552, __p2_552); \
51055 __ret_552; \
51056})
51057#else
51058#define vmulq_laneq_s16(__p0_553, __p1_553, __p2_553) __extension__ ({ \
51059 int16x8_t __ret_553; \
51060 int16x8_t __s0_553 = __p0_553; \
51061 int16x8_t __s1_553 = __p1_553; \
51062 int16x8_t __rev0_553; __rev0_553 = __builtin_shufflevector(__s0_553, __s0_553, 7, 6, 5, 4, 3, 2, 1, 0); \
51063 int16x8_t __rev1_553; __rev1_553 = __builtin_shufflevector(__s1_553, __s1_553, 7, 6, 5, 4, 3, 2, 1, 0); \
51064 __ret_553 = __rev0_553 * __noswap_splatq_laneq_s16(__rev1_553, __p2_553); \
51065 __ret_553 = __builtin_shufflevector(__ret_553, __ret_553, 7, 6, 5, 4, 3, 2, 1, 0); \
51066 __ret_553; \
51067})
51068#endif
51069
51070#ifdef __LITTLE_ENDIAN__
51071#define vmul_laneq_u32(__p0_554, __p1_554, __p2_554) __extension__ ({ \
51072 uint32x2_t __ret_554; \
51073 uint32x2_t __s0_554 = __p0_554; \
51074 uint32x4_t __s1_554 = __p1_554; \
51075 __ret_554 = __s0_554 * splat_laneq_u32(__s1_554, __p2_554); \
51076 __ret_554; \
51077})
51078#else
51079#define vmul_laneq_u32(__p0_555, __p1_555, __p2_555) __extension__ ({ \
51080 uint32x2_t __ret_555; \
51081 uint32x2_t __s0_555 = __p0_555; \
51082 uint32x4_t __s1_555 = __p1_555; \
51083 uint32x2_t __rev0_555; __rev0_555 = __builtin_shufflevector(__s0_555, __s0_555, 1, 0); \
51084 uint32x4_t __rev1_555; __rev1_555 = __builtin_shufflevector(__s1_555, __s1_555, 3, 2, 1, 0); \
51085 __ret_555 = __rev0_555 * __noswap_splat_laneq_u32(__rev1_555, __p2_555); \
51086 __ret_555 = __builtin_shufflevector(__ret_555, __ret_555, 1, 0); \
51087 __ret_555; \
51088})
51089#endif
51090
51091#ifdef __LITTLE_ENDIAN__
51092#define vmul_laneq_u16(__p0_556, __p1_556, __p2_556) __extension__ ({ \
51093 uint16x4_t __ret_556; \
51094 uint16x4_t __s0_556 = __p0_556; \
51095 uint16x8_t __s1_556 = __p1_556; \
51096 __ret_556 = __s0_556 * splat_laneq_u16(__s1_556, __p2_556); \
51097 __ret_556; \
51098})
51099#else
51100#define vmul_laneq_u16(__p0_557, __p1_557, __p2_557) __extension__ ({ \
51101 uint16x4_t __ret_557; \
51102 uint16x4_t __s0_557 = __p0_557; \
51103 uint16x8_t __s1_557 = __p1_557; \
51104 uint16x4_t __rev0_557; __rev0_557 = __builtin_shufflevector(__s0_557, __s0_557, 3, 2, 1, 0); \
51105 uint16x8_t __rev1_557; __rev1_557 = __builtin_shufflevector(__s1_557, __s1_557, 7, 6, 5, 4, 3, 2, 1, 0); \
51106 __ret_557 = __rev0_557 * __noswap_splat_laneq_u16(__rev1_557, __p2_557); \
51107 __ret_557 = __builtin_shufflevector(__ret_557, __ret_557, 3, 2, 1, 0); \
51108 __ret_557; \
51109})
51110#endif
51111
51112#ifdef __LITTLE_ENDIAN__
51113#define vmul_laneq_f32(__p0_558, __p1_558, __p2_558) __extension__ ({ \
51114 float32x2_t __ret_558; \
51115 float32x2_t __s0_558 = __p0_558; \
51116 float32x4_t __s1_558 = __p1_558; \
51117 __ret_558 = __s0_558 * splat_laneq_f32(__s1_558, __p2_558); \
51118 __ret_558; \
51119})
51120#else
51121#define vmul_laneq_f32(__p0_559, __p1_559, __p2_559) __extension__ ({ \
51122 float32x2_t __ret_559; \
51123 float32x2_t __s0_559 = __p0_559; \
51124 float32x4_t __s1_559 = __p1_559; \
51125 float32x2_t __rev0_559; __rev0_559 = __builtin_shufflevector(__s0_559, __s0_559, 1, 0); \
51126 float32x4_t __rev1_559; __rev1_559 = __builtin_shufflevector(__s1_559, __s1_559, 3, 2, 1, 0); \
51127 __ret_559 = __rev0_559 * __noswap_splat_laneq_f32(__rev1_559, __p2_559); \
51128 __ret_559 = __builtin_shufflevector(__ret_559, __ret_559, 1, 0); \
51129 __ret_559; \
51130})
51131#endif
51132
51133#ifdef __LITTLE_ENDIAN__
51134#define vmul_laneq_s32(__p0_560, __p1_560, __p2_560) __extension__ ({ \
51135 int32x2_t __ret_560; \
51136 int32x2_t __s0_560 = __p0_560; \
51137 int32x4_t __s1_560 = __p1_560; \
51138 __ret_560 = __s0_560 * splat_laneq_s32(__s1_560, __p2_560); \
51139 __ret_560; \
51140})
51141#else
51142#define vmul_laneq_s32(__p0_561, __p1_561, __p2_561) __extension__ ({ \
51143 int32x2_t __ret_561; \
51144 int32x2_t __s0_561 = __p0_561; \
51145 int32x4_t __s1_561 = __p1_561; \
51146 int32x2_t __rev0_561; __rev0_561 = __builtin_shufflevector(__s0_561, __s0_561, 1, 0); \
51147 int32x4_t __rev1_561; __rev1_561 = __builtin_shufflevector(__s1_561, __s1_561, 3, 2, 1, 0); \
51148 __ret_561 = __rev0_561 * __noswap_splat_laneq_s32(__rev1_561, __p2_561); \
51149 __ret_561 = __builtin_shufflevector(__ret_561, __ret_561, 1, 0); \
51150 __ret_561; \
51151})
51152#endif
51153
51154#ifdef __LITTLE_ENDIAN__
51155#define vmul_laneq_s16(__p0_562, __p1_562, __p2_562) __extension__ ({ \
51156 int16x4_t __ret_562; \
51157 int16x4_t __s0_562 = __p0_562; \
51158 int16x8_t __s1_562 = __p1_562; \
51159 __ret_562 = __s0_562 * splat_laneq_s16(__s1_562, __p2_562); \
51160 __ret_562; \
51161})
51162#else
51163#define vmul_laneq_s16(__p0_563, __p1_563, __p2_563) __extension__ ({ \
51164 int16x4_t __ret_563; \
51165 int16x4_t __s0_563 = __p0_563; \
51166 int16x8_t __s1_563 = __p1_563; \
51167 int16x4_t __rev0_563; __rev0_563 = __builtin_shufflevector(__s0_563, __s0_563, 3, 2, 1, 0); \
51168 int16x8_t __rev1_563; __rev1_563 = __builtin_shufflevector(__s1_563, __s1_563, 7, 6, 5, 4, 3, 2, 1, 0); \
51169 __ret_563 = __rev0_563 * __noswap_splat_laneq_s16(__rev1_563, __p2_563); \
51170 __ret_563 = __builtin_shufflevector(__ret_563, __ret_563, 3, 2, 1, 0); \
51171 __ret_563; \
51172})
51173#endif
51174
51175__ai float64x1_t vmul_n_f64(float64x1_t __p0, float64_t __p1) {
51176 float64x1_t __ret;
51177 __ret = (float64x1_t) __builtin_neon_vmul_n_f64((float64x1_t)__p0, __p1);
4995151178 return __ret;
4995251179}
49953__ai uint64_t vcltd_u64(uint64_t __p0, uint64_t __p1) {
49954 uint64_t __ret;
49955 __ret = (uint64_t) __builtin_neon_vcltd_u64(__p0, __p1);
51180#ifdef __LITTLE_ENDIAN__
51181__ai float64x2_t vmulq_n_f64(float64x2_t __p0, float64_t __p1) {
51182 float64x2_t __ret;
51183 __ret = __p0 * (float64x2_t) {__p1, __p1};
4995651184 return __ret;
4995751185}
49958__ai uint64_t vcltd_s64(int64_t __p0, int64_t __p1) {
49959 uint64_t __ret;
49960 __ret = (uint64_t) __builtin_neon_vcltd_s64(__p0, __p1);
51186#else
51187__ai float64x2_t vmulq_n_f64(float64x2_t __p0, float64_t __p1) {
51188 float64x2_t __ret;
51189 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
51190 __ret = __rev0 * (float64x2_t) {__p1, __p1};
51191 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
4996151192 return __ret;
4996251193}
49963__ai uint64_t vcltd_f64(float64_t __p0, float64_t __p1) {
49964 uint64_t __ret;
49965 __ret = (uint64_t) __builtin_neon_vcltd_f64(__p0, __p1);
51194#endif
51195
51196#ifdef __LITTLE_ENDIAN__
51197__ai poly16x8_t vmull_high_p8(poly8x16_t __p0, poly8x16_t __p1) {
51198 poly16x8_t __ret;
51199 __ret = vmull_p8(vget_high_p8(__p0), vget_high_p8(__p1));
4996651200 return __ret;
4996751201}
49968__ai uint32_t vclts_f32(float32_t __p0, float32_t __p1) {
49969 uint32_t __ret;
49970 __ret = (uint32_t) __builtin_neon_vclts_f32(__p0, __p1);
51202#else
51203__ai poly16x8_t vmull_high_p8(poly8x16_t __p0, poly8x16_t __p1) {
51204 poly16x8_t __ret;
51205 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
51206 poly8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
51207 __ret = __noswap_vmull_p8(__noswap_vget_high_p8(__rev0), __noswap_vget_high_p8(__rev1));
51208 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
4997151209 return __ret;
4997251210}
51211#endif
51212
4997351213#ifdef __LITTLE_ENDIAN__
49974__ai uint8x16_t vcltzq_s8(int8x16_t __p0) {
49975 uint8x16_t __ret;
49976 __ret = (uint8x16_t) __builtin_neon_vcltzq_v((int8x16_t)__p0, 48);
51214__ai uint16x8_t vmull_high_u8(uint8x16_t __p0, uint8x16_t __p1) {
51215 uint16x8_t __ret;
51216 __ret = vmull_u8(vget_high_u8(__p0), vget_high_u8(__p1));
4997751217 return __ret;
4997851218}
4997951219#else
49980__ai uint8x16_t vcltzq_s8(int8x16_t __p0) {
49981 uint8x16_t __ret;
49982 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
49983 __ret = (uint8x16_t) __builtin_neon_vcltzq_v((int8x16_t)__rev0, 48);
49984 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
51220__ai uint16x8_t vmull_high_u8(uint8x16_t __p0, uint8x16_t __p1) {
51221 uint16x8_t __ret;
51222 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
51223 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
51224 __ret = __noswap_vmull_u8(__noswap_vget_high_u8(__rev0), __noswap_vget_high_u8(__rev1));
51225 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
4998551226 return __ret;
4998651227}
4998751228#endif
4998851229
4998951230#ifdef __LITTLE_ENDIAN__
49990__ai uint64x2_t vcltzq_f64(float64x2_t __p0) {
51231__ai uint64x2_t vmull_high_u32(uint32x4_t __p0, uint32x4_t __p1) {
4999151232 uint64x2_t __ret;
49992 __ret = (uint64x2_t) __builtin_neon_vcltzq_v((int8x16_t)__p0, 51);
51233 __ret = vmull_u32(vget_high_u32(__p0), vget_high_u32(__p1));
4999351234 return __ret;
4999451235}
4999551236#else
49996__ai uint64x2_t vcltzq_f64(float64x2_t __p0) {
51237__ai uint64x2_t vmull_high_u32(uint32x4_t __p0, uint32x4_t __p1) {
4999751238 uint64x2_t __ret;
49998 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
49999 __ret = (uint64x2_t) __builtin_neon_vcltzq_v((int8x16_t)__rev0, 51);
51239 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
51240 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
51241 __ret = __noswap_vmull_u32(__noswap_vget_high_u32(__rev0), __noswap_vget_high_u32(__rev1));
5000051242 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
5000151243 return __ret;
5000251244}
5000351245#endif
5000451246
5000551247#ifdef __LITTLE_ENDIAN__
50006__ai uint32x4_t vcltzq_f32(float32x4_t __p0) {
51248__ai uint32x4_t vmull_high_u16(uint16x8_t __p0, uint16x8_t __p1) {
5000751249 uint32x4_t __ret;
50008 __ret = (uint32x4_t) __builtin_neon_vcltzq_v((int8x16_t)__p0, 50);
51250 __ret = vmull_u16(vget_high_u16(__p0), vget_high_u16(__p1));
5000951251 return __ret;
5001051252}
5001151253#else
50012__ai uint32x4_t vcltzq_f32(float32x4_t __p0) {
51254__ai uint32x4_t vmull_high_u16(uint16x8_t __p0, uint16x8_t __p1) {
5001351255 uint32x4_t __ret;
50014 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
50015 __ret = (uint32x4_t) __builtin_neon_vcltzq_v((int8x16_t)__rev0, 50);
51256 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
51257 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
51258 __ret = __noswap_vmull_u16(__noswap_vget_high_u16(__rev0), __noswap_vget_high_u16(__rev1));
5001651259 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
5001751260 return __ret;
5001851261}
5001951262#endif
5002051263
5002151264#ifdef __LITTLE_ENDIAN__
50022__ai uint32x4_t vcltzq_s32(int32x4_t __p0) {
50023 uint32x4_t __ret;
50024 __ret = (uint32x4_t) __builtin_neon_vcltzq_v((int8x16_t)__p0, 50);
51265__ai int16x8_t vmull_high_s8(int8x16_t __p0, int8x16_t __p1) {
51266 int16x8_t __ret;
51267 __ret = vmull_s8(vget_high_s8(__p0), vget_high_s8(__p1));
5002551268 return __ret;
5002651269}
5002751270#else
50028__ai uint32x4_t vcltzq_s32(int32x4_t __p0) {
50029 uint32x4_t __ret;
50030 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
50031 __ret = (uint32x4_t) __builtin_neon_vcltzq_v((int8x16_t)__rev0, 50);
50032 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
51271__ai int16x8_t vmull_high_s8(int8x16_t __p0, int8x16_t __p1) {
51272 int16x8_t __ret;
51273 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
51274 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
51275 __ret = __noswap_vmull_s8(__noswap_vget_high_s8(__rev0), __noswap_vget_high_s8(__rev1));
51276 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
5003351277 return __ret;
5003451278}
5003551279#endif
5003651280
5003751281#ifdef __LITTLE_ENDIAN__
50038__ai uint64x2_t vcltzq_s64(int64x2_t __p0) {
50039 uint64x2_t __ret;
50040 __ret = (uint64x2_t) __builtin_neon_vcltzq_v((int8x16_t)__p0, 51);
51282__ai int64x2_t vmull_high_s32(int32x4_t __p0, int32x4_t __p1) {
51283 int64x2_t __ret;
51284 __ret = vmull_s32(vget_high_s32(__p0), vget_high_s32(__p1));
5004151285 return __ret;
5004251286}
5004351287#else
50044__ai uint64x2_t vcltzq_s64(int64x2_t __p0) {
50045 uint64x2_t __ret;
50046 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
50047 __ret = (uint64x2_t) __builtin_neon_vcltzq_v((int8x16_t)__rev0, 51);
51288__ai int64x2_t vmull_high_s32(int32x4_t __p0, int32x4_t __p1) {
51289 int64x2_t __ret;
51290 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
51291 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
51292 __ret = __noswap_vmull_s32(__noswap_vget_high_s32(__rev0), __noswap_vget_high_s32(__rev1));
5004851293 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
5004951294 return __ret;
5005051295}
5005151296#endif
5005251297
5005351298#ifdef __LITTLE_ENDIAN__
50054__ai uint16x8_t vcltzq_s16(int16x8_t __p0) {
50055 uint16x8_t __ret;
50056 __ret = (uint16x8_t) __builtin_neon_vcltzq_v((int8x16_t)__p0, 49);
51299__ai int32x4_t vmull_high_s16(int16x8_t __p0, int16x8_t __p1) {
51300 int32x4_t __ret;
51301 __ret = vmull_s16(vget_high_s16(__p0), vget_high_s16(__p1));
5005751302 return __ret;
5005851303}
5005951304#else
50060__ai uint16x8_t vcltzq_s16(int16x8_t __p0) {
50061 uint16x8_t __ret;
51305__ai int32x4_t vmull_high_s16(int16x8_t __p0, int16x8_t __p1) {
51306 int32x4_t __ret;
5006251307 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
50063 __ret = (uint16x8_t) __builtin_neon_vcltzq_v((int8x16_t)__rev0, 49);
50064 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
51308 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
51309 __ret = __noswap_vmull_s16(__noswap_vget_high_s16(__rev0), __noswap_vget_high_s16(__rev1));
51310 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
5006551311 return __ret;
5006651312}
5006751313#endif
5006851314
5006951315#ifdef __LITTLE_ENDIAN__
50070__ai uint8x8_t vcltz_s8(int8x8_t __p0) {
50071 uint8x8_t __ret;
50072 __ret = (uint8x8_t) __builtin_neon_vcltz_v((int8x8_t)__p0, 16);
50073 return __ret;
50074}
51316#define vmull_high_lane_u32(__p0_564, __p1_564, __p2_564) __extension__ ({ \
51317 uint64x2_t __ret_564; \
51318 uint32x4_t __s0_564 = __p0_564; \
51319 uint32x2_t __s1_564 = __p1_564; \
51320 __ret_564 = vmull_u32(vget_high_u32(__s0_564), splat_lane_u32(__s1_564, __p2_564)); \
51321 __ret_564; \
51322})
5007551323#else
50076__ai uint8x8_t vcltz_s8(int8x8_t __p0) {
50077 uint8x8_t __ret;
50078 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
50079 __ret = (uint8x8_t) __builtin_neon_vcltz_v((int8x8_t)__rev0, 16);
50080 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
50081 return __ret;
50082}
51324#define vmull_high_lane_u32(__p0_565, __p1_565, __p2_565) __extension__ ({ \
51325 uint64x2_t __ret_565; \
51326 uint32x4_t __s0_565 = __p0_565; \
51327 uint32x2_t __s1_565 = __p1_565; \
51328 uint32x4_t __rev0_565; __rev0_565 = __builtin_shufflevector(__s0_565, __s0_565, 3, 2, 1, 0); \
51329 uint32x2_t __rev1_565; __rev1_565 = __builtin_shufflevector(__s1_565, __s1_565, 1, 0); \
51330 __ret_565 = __noswap_vmull_u32(__noswap_vget_high_u32(__rev0_565), __noswap_splat_lane_u32(__rev1_565, __p2_565)); \
51331 __ret_565 = __builtin_shufflevector(__ret_565, __ret_565, 1, 0); \
51332 __ret_565; \
51333})
5008351334#endif
5008451335
50085__ai uint64x1_t vcltz_f64(float64x1_t __p0) {
50086 uint64x1_t __ret;
50087 __ret = (uint64x1_t) __builtin_neon_vcltz_v((int8x8_t)__p0, 19);
50088 return __ret;
50089}
5009051336#ifdef __LITTLE_ENDIAN__
50091__ai uint32x2_t vcltz_f32(float32x2_t __p0) {
50092 uint32x2_t __ret;
50093 __ret = (uint32x2_t) __builtin_neon_vcltz_v((int8x8_t)__p0, 18);
50094 return __ret;
50095}
51337#define vmull_high_lane_u16(__p0_566, __p1_566, __p2_566) __extension__ ({ \
51338 uint32x4_t __ret_566; \
51339 uint16x8_t __s0_566 = __p0_566; \
51340 uint16x4_t __s1_566 = __p1_566; \
51341 __ret_566 = vmull_u16(vget_high_u16(__s0_566), splat_lane_u16(__s1_566, __p2_566)); \
51342 __ret_566; \
51343})
5009651344#else
50097__ai uint32x2_t vcltz_f32(float32x2_t __p0) {
50098 uint32x2_t __ret;
50099 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
50100 __ret = (uint32x2_t) __builtin_neon_vcltz_v((int8x8_t)__rev0, 18);
50101 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
50102 return __ret;
50103}
51345#define vmull_high_lane_u16(__p0_567, __p1_567, __p2_567) __extension__ ({ \
51346 uint32x4_t __ret_567; \
51347 uint16x8_t __s0_567 = __p0_567; \
51348 uint16x4_t __s1_567 = __p1_567; \
51349 uint16x8_t __rev0_567; __rev0_567 = __builtin_shufflevector(__s0_567, __s0_567, 7, 6, 5, 4, 3, 2, 1, 0); \
51350 uint16x4_t __rev1_567; __rev1_567 = __builtin_shufflevector(__s1_567, __s1_567, 3, 2, 1, 0); \
51351 __ret_567 = __noswap_vmull_u16(__noswap_vget_high_u16(__rev0_567), __noswap_splat_lane_u16(__rev1_567, __p2_567)); \
51352 __ret_567 = __builtin_shufflevector(__ret_567, __ret_567, 3, 2, 1, 0); \
51353 __ret_567; \
51354})
5010451355#endif
5010551356
5010651357#ifdef __LITTLE_ENDIAN__
50107__ai uint32x2_t vcltz_s32(int32x2_t __p0) {
50108 uint32x2_t __ret;
50109 __ret = (uint32x2_t) __builtin_neon_vcltz_v((int8x8_t)__p0, 18);
51358#define vmull_high_lane_s32(__p0_568, __p1_568, __p2_568) __extension__ ({ \
51359 int64x2_t __ret_568; \
51360 int32x4_t __s0_568 = __p0_568; \
51361 int32x2_t __s1_568 = __p1_568; \
51362 __ret_568 = vmull_s32(vget_high_s32(__s0_568), splat_lane_s32(__s1_568, __p2_568)); \
51363 __ret_568; \
51364})
51365#else
51366#define vmull_high_lane_s32(__p0_569, __p1_569, __p2_569) __extension__ ({ \
51367 int64x2_t __ret_569; \
51368 int32x4_t __s0_569 = __p0_569; \
51369 int32x2_t __s1_569 = __p1_569; \
51370 int32x4_t __rev0_569; __rev0_569 = __builtin_shufflevector(__s0_569, __s0_569, 3, 2, 1, 0); \
51371 int32x2_t __rev1_569; __rev1_569 = __builtin_shufflevector(__s1_569, __s1_569, 1, 0); \
51372 __ret_569 = __noswap_vmull_s32(__noswap_vget_high_s32(__rev0_569), __noswap_splat_lane_s32(__rev1_569, __p2_569)); \
51373 __ret_569 = __builtin_shufflevector(__ret_569, __ret_569, 1, 0); \
51374 __ret_569; \
51375})
51376#endif
51377
51378#ifdef __LITTLE_ENDIAN__
51379#define vmull_high_lane_s16(__p0_570, __p1_570, __p2_570) __extension__ ({ \
51380 int32x4_t __ret_570; \
51381 int16x8_t __s0_570 = __p0_570; \
51382 int16x4_t __s1_570 = __p1_570; \
51383 __ret_570 = vmull_s16(vget_high_s16(__s0_570), splat_lane_s16(__s1_570, __p2_570)); \
51384 __ret_570; \
51385})
51386#else
51387#define vmull_high_lane_s16(__p0_571, __p1_571, __p2_571) __extension__ ({ \
51388 int32x4_t __ret_571; \
51389 int16x8_t __s0_571 = __p0_571; \
51390 int16x4_t __s1_571 = __p1_571; \
51391 int16x8_t __rev0_571; __rev0_571 = __builtin_shufflevector(__s0_571, __s0_571, 7, 6, 5, 4, 3, 2, 1, 0); \
51392 int16x4_t __rev1_571; __rev1_571 = __builtin_shufflevector(__s1_571, __s1_571, 3, 2, 1, 0); \
51393 __ret_571 = __noswap_vmull_s16(__noswap_vget_high_s16(__rev0_571), __noswap_splat_lane_s16(__rev1_571, __p2_571)); \
51394 __ret_571 = __builtin_shufflevector(__ret_571, __ret_571, 3, 2, 1, 0); \
51395 __ret_571; \
51396})
51397#endif
51398
51399#ifdef __LITTLE_ENDIAN__
51400#define vmull_high_laneq_u32(__p0_572, __p1_572, __p2_572) __extension__ ({ \
51401 uint64x2_t __ret_572; \
51402 uint32x4_t __s0_572 = __p0_572; \
51403 uint32x4_t __s1_572 = __p1_572; \
51404 __ret_572 = vmull_u32(vget_high_u32(__s0_572), splat_laneq_u32(__s1_572, __p2_572)); \
51405 __ret_572; \
51406})
51407#else
51408#define vmull_high_laneq_u32(__p0_573, __p1_573, __p2_573) __extension__ ({ \
51409 uint64x2_t __ret_573; \
51410 uint32x4_t __s0_573 = __p0_573; \
51411 uint32x4_t __s1_573 = __p1_573; \
51412 uint32x4_t __rev0_573; __rev0_573 = __builtin_shufflevector(__s0_573, __s0_573, 3, 2, 1, 0); \
51413 uint32x4_t __rev1_573; __rev1_573 = __builtin_shufflevector(__s1_573, __s1_573, 3, 2, 1, 0); \
51414 __ret_573 = __noswap_vmull_u32(__noswap_vget_high_u32(__rev0_573), __noswap_splat_laneq_u32(__rev1_573, __p2_573)); \
51415 __ret_573 = __builtin_shufflevector(__ret_573, __ret_573, 1, 0); \
51416 __ret_573; \
51417})
51418#endif
51419
51420#ifdef __LITTLE_ENDIAN__
51421#define vmull_high_laneq_u16(__p0_574, __p1_574, __p2_574) __extension__ ({ \
51422 uint32x4_t __ret_574; \
51423 uint16x8_t __s0_574 = __p0_574; \
51424 uint16x8_t __s1_574 = __p1_574; \
51425 __ret_574 = vmull_u16(vget_high_u16(__s0_574), splat_laneq_u16(__s1_574, __p2_574)); \
51426 __ret_574; \
51427})
51428#else
51429#define vmull_high_laneq_u16(__p0_575, __p1_575, __p2_575) __extension__ ({ \
51430 uint32x4_t __ret_575; \
51431 uint16x8_t __s0_575 = __p0_575; \
51432 uint16x8_t __s1_575 = __p1_575; \
51433 uint16x8_t __rev0_575; __rev0_575 = __builtin_shufflevector(__s0_575, __s0_575, 7, 6, 5, 4, 3, 2, 1, 0); \
51434 uint16x8_t __rev1_575; __rev1_575 = __builtin_shufflevector(__s1_575, __s1_575, 7, 6, 5, 4, 3, 2, 1, 0); \
51435 __ret_575 = __noswap_vmull_u16(__noswap_vget_high_u16(__rev0_575), __noswap_splat_laneq_u16(__rev1_575, __p2_575)); \
51436 __ret_575 = __builtin_shufflevector(__ret_575, __ret_575, 3, 2, 1, 0); \
51437 __ret_575; \
51438})
51439#endif
51440
51441#ifdef __LITTLE_ENDIAN__
51442#define vmull_high_laneq_s32(__p0_576, __p1_576, __p2_576) __extension__ ({ \
51443 int64x2_t __ret_576; \
51444 int32x4_t __s0_576 = __p0_576; \
51445 int32x4_t __s1_576 = __p1_576; \
51446 __ret_576 = vmull_s32(vget_high_s32(__s0_576), splat_laneq_s32(__s1_576, __p2_576)); \
51447 __ret_576; \
51448})
51449#else
51450#define vmull_high_laneq_s32(__p0_577, __p1_577, __p2_577) __extension__ ({ \
51451 int64x2_t __ret_577; \
51452 int32x4_t __s0_577 = __p0_577; \
51453 int32x4_t __s1_577 = __p1_577; \
51454 int32x4_t __rev0_577; __rev0_577 = __builtin_shufflevector(__s0_577, __s0_577, 3, 2, 1, 0); \
51455 int32x4_t __rev1_577; __rev1_577 = __builtin_shufflevector(__s1_577, __s1_577, 3, 2, 1, 0); \
51456 __ret_577 = __noswap_vmull_s32(__noswap_vget_high_s32(__rev0_577), __noswap_splat_laneq_s32(__rev1_577, __p2_577)); \
51457 __ret_577 = __builtin_shufflevector(__ret_577, __ret_577, 1, 0); \
51458 __ret_577; \
51459})
51460#endif
51461
51462#ifdef __LITTLE_ENDIAN__
51463#define vmull_high_laneq_s16(__p0_578, __p1_578, __p2_578) __extension__ ({ \
51464 int32x4_t __ret_578; \
51465 int16x8_t __s0_578 = __p0_578; \
51466 int16x8_t __s1_578 = __p1_578; \
51467 __ret_578 = vmull_s16(vget_high_s16(__s0_578), splat_laneq_s16(__s1_578, __p2_578)); \
51468 __ret_578; \
51469})
51470#else
51471#define vmull_high_laneq_s16(__p0_579, __p1_579, __p2_579) __extension__ ({ \
51472 int32x4_t __ret_579; \
51473 int16x8_t __s0_579 = __p0_579; \
51474 int16x8_t __s1_579 = __p1_579; \
51475 int16x8_t __rev0_579; __rev0_579 = __builtin_shufflevector(__s0_579, __s0_579, 7, 6, 5, 4, 3, 2, 1, 0); \
51476 int16x8_t __rev1_579; __rev1_579 = __builtin_shufflevector(__s1_579, __s1_579, 7, 6, 5, 4, 3, 2, 1, 0); \
51477 __ret_579 = __noswap_vmull_s16(__noswap_vget_high_s16(__rev0_579), __noswap_splat_laneq_s16(__rev1_579, __p2_579)); \
51478 __ret_579 = __builtin_shufflevector(__ret_579, __ret_579, 3, 2, 1, 0); \
51479 __ret_579; \
51480})
51481#endif
51482
51483#ifdef __LITTLE_ENDIAN__
51484__ai uint64x2_t vmull_high_n_u32(uint32x4_t __p0, uint32_t __p1) {
51485 uint64x2_t __ret;
51486 __ret = vmull_n_u32(vget_high_u32(__p0), __p1);
5011051487 return __ret;
5011151488}
5011251489#else
50113__ai uint32x2_t vcltz_s32(int32x2_t __p0) {
50114 uint32x2_t __ret;
50115 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
50116 __ret = (uint32x2_t) __builtin_neon_vcltz_v((int8x8_t)__rev0, 18);
51490__ai uint64x2_t vmull_high_n_u32(uint32x4_t __p0, uint32_t __p1) {
51491 uint64x2_t __ret;
51492 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
51493 __ret = __noswap_vmull_n_u32(__noswap_vget_high_u32(__rev0), __p1);
5011751494 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
5011851495 return __ret;
5011951496}
5012051497#endif
5012151498
50122__ai uint64x1_t vcltz_s64(int64x1_t __p0) {
50123 uint64x1_t __ret;
50124 __ret = (uint64x1_t) __builtin_neon_vcltz_v((int8x8_t)__p0, 19);
50125 return __ret;
50126}
5012751499#ifdef __LITTLE_ENDIAN__
50128__ai uint16x4_t vcltz_s16(int16x4_t __p0) {
50129 uint16x4_t __ret;
50130 __ret = (uint16x4_t) __builtin_neon_vcltz_v((int8x8_t)__p0, 17);
51500__ai uint32x4_t vmull_high_n_u16(uint16x8_t __p0, uint16_t __p1) {
51501 uint32x4_t __ret;
51502 __ret = vmull_n_u16(vget_high_u16(__p0), __p1);
5013151503 return __ret;
5013251504}
5013351505#else
50134__ai uint16x4_t vcltz_s16(int16x4_t __p0) {
50135 uint16x4_t __ret;
50136 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
50137 __ret = (uint16x4_t) __builtin_neon_vcltz_v((int8x8_t)__rev0, 17);
51506__ai uint32x4_t vmull_high_n_u16(uint16x8_t __p0, uint16_t __p1) {
51507 uint32x4_t __ret;
51508 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
51509 __ret = __noswap_vmull_n_u16(__noswap_vget_high_u16(__rev0), __p1);
5013851510 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
5013951511 return __ret;
5014051512}
5014151513#endif
5014251514
50143__ai uint64_t vcltzd_s64(int64_t __p0) {
50144 uint64_t __ret;
50145 __ret = (uint64_t) __builtin_neon_vcltzd_s64(__p0);
50146 return __ret;
50147}
50148__ai uint64_t vcltzd_f64(float64_t __p0) {
50149 uint64_t __ret;
50150 __ret = (uint64_t) __builtin_neon_vcltzd_f64(__p0);
50151 return __ret;
50152}
50153__ai uint32_t vcltzs_f32(float32_t __p0) {
50154 uint32_t __ret;
50155 __ret = (uint32_t) __builtin_neon_vcltzs_f32(__p0);
50156 return __ret;
50157}
5015851515#ifdef __LITTLE_ENDIAN__
50159__ai poly64x2_t vcombine_p64(poly64x1_t __p0, poly64x1_t __p1) {
50160 poly64x2_t __ret;
50161 __ret = __builtin_shufflevector(__p0, __p1, 0, 1);
51516__ai int64x2_t vmull_high_n_s32(int32x4_t __p0, int32_t __p1) {
51517 int64x2_t __ret;
51518 __ret = vmull_n_s32(vget_high_s32(__p0), __p1);
5016251519 return __ret;
5016351520}
5016451521#else
50165__ai poly64x2_t vcombine_p64(poly64x1_t __p0, poly64x1_t __p1) {
50166 poly64x2_t __ret;
50167 __ret = __builtin_shufflevector(__p0, __p1, 0, 1);
51522__ai int64x2_t vmull_high_n_s32(int32x4_t __p0, int32_t __p1) {
51523 int64x2_t __ret;
51524 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
51525 __ret = __noswap_vmull_n_s32(__noswap_vget_high_s32(__rev0), __p1);
5016851526 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
5016951527 return __ret;
5017051528}
5017151529#endif
5017251530
5017351531#ifdef __LITTLE_ENDIAN__
50174__ai float64x2_t vcombine_f64(float64x1_t __p0, float64x1_t __p1) {
50175 float64x2_t __ret;
50176 __ret = __builtin_shufflevector(__p0, __p1, 0, 1);
51532__ai int32x4_t vmull_high_n_s16(int16x8_t __p0, int16_t __p1) {
51533 int32x4_t __ret;
51534 __ret = vmull_n_s16(vget_high_s16(__p0), __p1);
5017751535 return __ret;
5017851536}
5017951537#else
50180__ai float64x2_t vcombine_f64(float64x1_t __p0, float64x1_t __p1) {
50181 float64x2_t __ret;
50182 __ret = __builtin_shufflevector(__p0, __p1, 0, 1);
50183 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
51538__ai int32x4_t vmull_high_n_s16(int16x8_t __p0, int16_t __p1) {
51539 int32x4_t __ret;
51540 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
51541 __ret = __noswap_vmull_n_s16(__noswap_vget_high_s16(__rev0), __p1);
51542 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
5018451543 return __ret;
5018551544}
5018651545#endif
5018751546
5018851547#ifdef __LITTLE_ENDIAN__
50189#define vcopyq_lane_p8(__p0_357, __p1_357, __p2_357, __p3_357) __extension__ ({ \
50190 poly8x16_t __ret_357; \
50191 poly8x16_t __s0_357 = __p0_357; \
50192 poly8x8_t __s2_357 = __p2_357; \
50193 __ret_357 = vsetq_lane_p8(vget_lane_p8(__s2_357, __p3_357), __s0_357, __p1_357); \
50194 __ret_357; \
51548#define vmull_laneq_u32(__p0_580, __p1_580, __p2_580) __extension__ ({ \
51549 uint64x2_t __ret_580; \
51550 uint32x2_t __s0_580 = __p0_580; \
51551 uint32x4_t __s1_580 = __p1_580; \
51552 __ret_580 = vmull_u32(__s0_580, splat_laneq_u32(__s1_580, __p2_580)); \
51553 __ret_580; \
5019551554})
5019651555#else
50197#define vcopyq_lane_p8(__p0_358, __p1_358, __p2_358, __p3_358) __extension__ ({ \
50198 poly8x16_t __ret_358; \
50199 poly8x16_t __s0_358 = __p0_358; \
50200 poly8x8_t __s2_358 = __p2_358; \
50201 poly8x16_t __rev0_358; __rev0_358 = __builtin_shufflevector(__s0_358, __s0_358, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
50202 poly8x8_t __rev2_358; __rev2_358 = __builtin_shufflevector(__s2_358, __s2_358, 7, 6, 5, 4, 3, 2, 1, 0); \
50203 __ret_358 = __noswap_vsetq_lane_p8(__noswap_vget_lane_p8(__rev2_358, __p3_358), __rev0_358, __p1_358); \
50204 __ret_358 = __builtin_shufflevector(__ret_358, __ret_358, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
50205 __ret_358; \
51556#define vmull_laneq_u32(__p0_581, __p1_581, __p2_581) __extension__ ({ \
51557 uint64x2_t __ret_581; \
51558 uint32x2_t __s0_581 = __p0_581; \
51559 uint32x4_t __s1_581 = __p1_581; \
51560 uint32x2_t __rev0_581; __rev0_581 = __builtin_shufflevector(__s0_581, __s0_581, 1, 0); \
51561 uint32x4_t __rev1_581; __rev1_581 = __builtin_shufflevector(__s1_581, __s1_581, 3, 2, 1, 0); \
51562 __ret_581 = __noswap_vmull_u32(__rev0_581, __noswap_splat_laneq_u32(__rev1_581, __p2_581)); \
51563 __ret_581 = __builtin_shufflevector(__ret_581, __ret_581, 1, 0); \
51564 __ret_581; \
5020651565})
5020751566#endif
5020851567
5020951568#ifdef __LITTLE_ENDIAN__
50210#define vcopyq_lane_p16(__p0_359, __p1_359, __p2_359, __p3_359) __extension__ ({ \
50211 poly16x8_t __ret_359; \
50212 poly16x8_t __s0_359 = __p0_359; \
50213 poly16x4_t __s2_359 = __p2_359; \
50214 __ret_359 = vsetq_lane_p16(vget_lane_p16(__s2_359, __p3_359), __s0_359, __p1_359); \
50215 __ret_359; \
51569#define vmull_laneq_u16(__p0_582, __p1_582, __p2_582) __extension__ ({ \
51570 uint32x4_t __ret_582; \
51571 uint16x4_t __s0_582 = __p0_582; \
51572 uint16x8_t __s1_582 = __p1_582; \
51573 __ret_582 = vmull_u16(__s0_582, splat_laneq_u16(__s1_582, __p2_582)); \
51574 __ret_582; \
5021651575})
5021751576#else
50218#define vcopyq_lane_p16(__p0_360, __p1_360, __p2_360, __p3_360) __extension__ ({ \
50219 poly16x8_t __ret_360; \
50220 poly16x8_t __s0_360 = __p0_360; \
50221 poly16x4_t __s2_360 = __p2_360; \
50222 poly16x8_t __rev0_360; __rev0_360 = __builtin_shufflevector(__s0_360, __s0_360, 7, 6, 5, 4, 3, 2, 1, 0); \
50223 poly16x4_t __rev2_360; __rev2_360 = __builtin_shufflevector(__s2_360, __s2_360, 3, 2, 1, 0); \
50224 __ret_360 = __noswap_vsetq_lane_p16(__noswap_vget_lane_p16(__rev2_360, __p3_360), __rev0_360, __p1_360); \
50225 __ret_360 = __builtin_shufflevector(__ret_360, __ret_360, 7, 6, 5, 4, 3, 2, 1, 0); \
50226 __ret_360; \
51577#define vmull_laneq_u16(__p0_583, __p1_583, __p2_583) __extension__ ({ \
51578 uint32x4_t __ret_583; \
51579 uint16x4_t __s0_583 = __p0_583; \
51580 uint16x8_t __s1_583 = __p1_583; \
51581 uint16x4_t __rev0_583; __rev0_583 = __builtin_shufflevector(__s0_583, __s0_583, 3, 2, 1, 0); \
51582 uint16x8_t __rev1_583; __rev1_583 = __builtin_shufflevector(__s1_583, __s1_583, 7, 6, 5, 4, 3, 2, 1, 0); \
51583 __ret_583 = __noswap_vmull_u16(__rev0_583, __noswap_splat_laneq_u16(__rev1_583, __p2_583)); \
51584 __ret_583 = __builtin_shufflevector(__ret_583, __ret_583, 3, 2, 1, 0); \
51585 __ret_583; \
5022751586})
5022851587#endif
5022951588
5023051589#ifdef __LITTLE_ENDIAN__
50231#define vcopyq_lane_u8(__p0_361, __p1_361, __p2_361, __p3_361) __extension__ ({ \
50232 uint8x16_t __ret_361; \
50233 uint8x16_t __s0_361 = __p0_361; \
50234 uint8x8_t __s2_361 = __p2_361; \
50235 __ret_361 = vsetq_lane_u8(vget_lane_u8(__s2_361, __p3_361), __s0_361, __p1_361); \
50236 __ret_361; \
51590#define vmull_laneq_s32(__p0_584, __p1_584, __p2_584) __extension__ ({ \
51591 int64x2_t __ret_584; \
51592 int32x2_t __s0_584 = __p0_584; \
51593 int32x4_t __s1_584 = __p1_584; \
51594 __ret_584 = vmull_s32(__s0_584, splat_laneq_s32(__s1_584, __p2_584)); \
51595 __ret_584; \
5023751596})
5023851597#else
50239#define vcopyq_lane_u8(__p0_362, __p1_362, __p2_362, __p3_362) __extension__ ({ \
50240 uint8x16_t __ret_362; \
50241 uint8x16_t __s0_362 = __p0_362; \
50242 uint8x8_t __s2_362 = __p2_362; \
50243 uint8x16_t __rev0_362; __rev0_362 = __builtin_shufflevector(__s0_362, __s0_362, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
50244 uint8x8_t __rev2_362; __rev2_362 = __builtin_shufflevector(__s2_362, __s2_362, 7, 6, 5, 4, 3, 2, 1, 0); \
50245 __ret_362 = __noswap_vsetq_lane_u8(__noswap_vget_lane_u8(__rev2_362, __p3_362), __rev0_362, __p1_362); \
50246 __ret_362 = __builtin_shufflevector(__ret_362, __ret_362, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
50247 __ret_362; \
51598#define vmull_laneq_s32(__p0_585, __p1_585, __p2_585) __extension__ ({ \
51599 int64x2_t __ret_585; \
51600 int32x2_t __s0_585 = __p0_585; \
51601 int32x4_t __s1_585 = __p1_585; \
51602 int32x2_t __rev0_585; __rev0_585 = __builtin_shufflevector(__s0_585, __s0_585, 1, 0); \
51603 int32x4_t __rev1_585; __rev1_585 = __builtin_shufflevector(__s1_585, __s1_585, 3, 2, 1, 0); \
51604 __ret_585 = __noswap_vmull_s32(__rev0_585, __noswap_splat_laneq_s32(__rev1_585, __p2_585)); \
51605 __ret_585 = __builtin_shufflevector(__ret_585, __ret_585, 1, 0); \
51606 __ret_585; \
5024851607})
5024951608#endif
5025051609
5025151610#ifdef __LITTLE_ENDIAN__
50252#define vcopyq_lane_u32(__p0_363, __p1_363, __p2_363, __p3_363) __extension__ ({ \
50253 uint32x4_t __ret_363; \
50254 uint32x4_t __s0_363 = __p0_363; \
50255 uint32x2_t __s2_363 = __p2_363; \
50256 __ret_363 = vsetq_lane_u32(vget_lane_u32(__s2_363, __p3_363), __s0_363, __p1_363); \
50257 __ret_363; \
51611#define vmull_laneq_s16(__p0_586, __p1_586, __p2_586) __extension__ ({ \
51612 int32x4_t __ret_586; \
51613 int16x4_t __s0_586 = __p0_586; \
51614 int16x8_t __s1_586 = __p1_586; \
51615 __ret_586 = vmull_s16(__s0_586, splat_laneq_s16(__s1_586, __p2_586)); \
51616 __ret_586; \
5025851617})
5025951618#else
50260#define vcopyq_lane_u32(__p0_364, __p1_364, __p2_364, __p3_364) __extension__ ({ \
50261 uint32x4_t __ret_364; \
50262 uint32x4_t __s0_364 = __p0_364; \
50263 uint32x2_t __s2_364 = __p2_364; \
50264 uint32x4_t __rev0_364; __rev0_364 = __builtin_shufflevector(__s0_364, __s0_364, 3, 2, 1, 0); \
50265 uint32x2_t __rev2_364; __rev2_364 = __builtin_shufflevector(__s2_364, __s2_364, 1, 0); \
50266 __ret_364 = __noswap_vsetq_lane_u32(__noswap_vget_lane_u32(__rev2_364, __p3_364), __rev0_364, __p1_364); \
50267 __ret_364 = __builtin_shufflevector(__ret_364, __ret_364, 3, 2, 1, 0); \
50268 __ret_364; \
51619#define vmull_laneq_s16(__p0_587, __p1_587, __p2_587) __extension__ ({ \
51620 int32x4_t __ret_587; \
51621 int16x4_t __s0_587 = __p0_587; \
51622 int16x8_t __s1_587 = __p1_587; \
51623 int16x4_t __rev0_587; __rev0_587 = __builtin_shufflevector(__s0_587, __s0_587, 3, 2, 1, 0); \
51624 int16x8_t __rev1_587; __rev1_587 = __builtin_shufflevector(__s1_587, __s1_587, 7, 6, 5, 4, 3, 2, 1, 0); \
51625 __ret_587 = __noswap_vmull_s16(__rev0_587, __noswap_splat_laneq_s16(__rev1_587, __p2_587)); \
51626 __ret_587 = __builtin_shufflevector(__ret_587, __ret_587, 3, 2, 1, 0); \
51627 __ret_587; \
5026951628})
5027051629#endif
5027151630
5027251631#ifdef __LITTLE_ENDIAN__
50273#define vcopyq_lane_u64(__p0_365, __p1_365, __p2_365, __p3_365) __extension__ ({ \
50274 uint64x2_t __ret_365; \
50275 uint64x2_t __s0_365 = __p0_365; \
50276 uint64x1_t __s2_365 = __p2_365; \
50277 __ret_365 = vsetq_lane_u64(vget_lane_u64(__s2_365, __p3_365), __s0_365, __p1_365); \
50278 __ret_365; \
50279})
51632__ai float64x2_t vmulxq_f64(float64x2_t __p0, float64x2_t __p1) {
51633 float64x2_t __ret;
51634 __ret = (float64x2_t) __builtin_neon_vmulxq_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
51635 return __ret;
51636}
5028051637#else
50281#define vcopyq_lane_u64(__p0_366, __p1_366, __p2_366, __p3_366) __extension__ ({ \
50282 uint64x2_t __ret_366; \
50283 uint64x2_t __s0_366 = __p0_366; \
50284 uint64x1_t __s2_366 = __p2_366; \
50285 uint64x2_t __rev0_366; __rev0_366 = __builtin_shufflevector(__s0_366, __s0_366, 1, 0); \
50286 __ret_366 = __noswap_vsetq_lane_u64(vget_lane_u64(__s2_366, __p3_366), __rev0_366, __p1_366); \
50287 __ret_366 = __builtin_shufflevector(__ret_366, __ret_366, 1, 0); \
50288 __ret_366; \
50289})
51638__ai float64x2_t vmulxq_f64(float64x2_t __p0, float64x2_t __p1) {
51639 float64x2_t __ret;
51640 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
51641 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
51642 __ret = (float64x2_t) __builtin_neon_vmulxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
51643 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
51644 return __ret;
51645}
51646__ai float64x2_t __noswap_vmulxq_f64(float64x2_t __p0, float64x2_t __p1) {
51647 float64x2_t __ret;
51648 __ret = (float64x2_t) __builtin_neon_vmulxq_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
51649 return __ret;
51650}
5029051651#endif
5029151652
5029251653#ifdef __LITTLE_ENDIAN__
50293#define vcopyq_lane_u16(__p0_367, __p1_367, __p2_367, __p3_367) __extension__ ({ \
50294 uint16x8_t __ret_367; \
50295 uint16x8_t __s0_367 = __p0_367; \
50296 uint16x4_t __s2_367 = __p2_367; \
50297 __ret_367 = vsetq_lane_u16(vget_lane_u16(__s2_367, __p3_367), __s0_367, __p1_367); \
50298 __ret_367; \
50299})
51654__ai float32x4_t vmulxq_f32(float32x4_t __p0, float32x4_t __p1) {
51655 float32x4_t __ret;
51656 __ret = (float32x4_t) __builtin_neon_vmulxq_v((int8x16_t)__p0, (int8x16_t)__p1, 41);
51657 return __ret;
51658}
5030051659#else
50301#define vcopyq_lane_u16(__p0_368, __p1_368, __p2_368, __p3_368) __extension__ ({ \
50302 uint16x8_t __ret_368; \
50303 uint16x8_t __s0_368 = __p0_368; \
50304 uint16x4_t __s2_368 = __p2_368; \
50305 uint16x8_t __rev0_368; __rev0_368 = __builtin_shufflevector(__s0_368, __s0_368, 7, 6, 5, 4, 3, 2, 1, 0); \
50306 uint16x4_t __rev2_368; __rev2_368 = __builtin_shufflevector(__s2_368, __s2_368, 3, 2, 1, 0); \
50307 __ret_368 = __noswap_vsetq_lane_u16(__noswap_vget_lane_u16(__rev2_368, __p3_368), __rev0_368, __p1_368); \
50308 __ret_368 = __builtin_shufflevector(__ret_368, __ret_368, 7, 6, 5, 4, 3, 2, 1, 0); \
50309 __ret_368; \
50310})
51660__ai float32x4_t vmulxq_f32(float32x4_t __p0, float32x4_t __p1) {
51661 float32x4_t __ret;
51662 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
51663 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
51664 __ret = (float32x4_t) __builtin_neon_vmulxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 41);
51665 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
51666 return __ret;
51667}
51668__ai float32x4_t __noswap_vmulxq_f32(float32x4_t __p0, float32x4_t __p1) {
51669 float32x4_t __ret;
51670 __ret = (float32x4_t) __builtin_neon_vmulxq_v((int8x16_t)__p0, (int8x16_t)__p1, 41);
51671 return __ret;
51672}
5031151673#endif
5031251674
51675__ai float64x1_t vmulx_f64(float64x1_t __p0, float64x1_t __p1) {
51676 float64x1_t __ret;
51677 __ret = (float64x1_t) __builtin_neon_vmulx_v((int8x8_t)__p0, (int8x8_t)__p1, 10);
51678 return __ret;
51679}
5031351680#ifdef __LITTLE_ENDIAN__
50314#define vcopyq_lane_s8(__p0_369, __p1_369, __p2_369, __p3_369) __extension__ ({ \
50315 int8x16_t __ret_369; \
50316 int8x16_t __s0_369 = __p0_369; \
50317 int8x8_t __s2_369 = __p2_369; \
50318 __ret_369 = vsetq_lane_s8(vget_lane_s8(__s2_369, __p3_369), __s0_369, __p1_369); \
50319 __ret_369; \
50320})
51681__ai float32x2_t vmulx_f32(float32x2_t __p0, float32x2_t __p1) {
51682 float32x2_t __ret;
51683 __ret = (float32x2_t) __builtin_neon_vmulx_v((int8x8_t)__p0, (int8x8_t)__p1, 9);
51684 return __ret;
51685}
5032151686#else
50322#define vcopyq_lane_s8(__p0_370, __p1_370, __p2_370, __p3_370) __extension__ ({ \
50323 int8x16_t __ret_370; \
50324 int8x16_t __s0_370 = __p0_370; \
50325 int8x8_t __s2_370 = __p2_370; \
50326 int8x16_t __rev0_370; __rev0_370 = __builtin_shufflevector(__s0_370, __s0_370, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
50327 int8x8_t __rev2_370; __rev2_370 = __builtin_shufflevector(__s2_370, __s2_370, 7, 6, 5, 4, 3, 2, 1, 0); \
50328 __ret_370 = __noswap_vsetq_lane_s8(__noswap_vget_lane_s8(__rev2_370, __p3_370), __rev0_370, __p1_370); \
50329 __ret_370 = __builtin_shufflevector(__ret_370, __ret_370, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
50330 __ret_370; \
50331})
51687__ai float32x2_t vmulx_f32(float32x2_t __p0, float32x2_t __p1) {
51688 float32x2_t __ret;
51689 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
51690 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
51691 __ret = (float32x2_t) __builtin_neon_vmulx_v((int8x8_t)__rev0, (int8x8_t)__rev1, 9);
51692 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
51693 return __ret;
51694}
51695__ai float32x2_t __noswap_vmulx_f32(float32x2_t __p0, float32x2_t __p1) {
51696 float32x2_t __ret;
51697 __ret = (float32x2_t) __builtin_neon_vmulx_v((int8x8_t)__p0, (int8x8_t)__p1, 9);
51698 return __ret;
51699}
5033251700#endif
5033351701
51702__ai float64_t vmulxd_f64(float64_t __p0, float64_t __p1) {
51703 float64_t __ret;
51704 __ret = (float64_t) __builtin_neon_vmulxd_f64(__p0, __p1);
51705 return __ret;
51706}
51707__ai float32_t vmulxs_f32(float32_t __p0, float32_t __p1) {
51708 float32_t __ret;
51709 __ret = (float32_t) __builtin_neon_vmulxs_f32(__p0, __p1);
51710 return __ret;
51711}
51712#define vmulxd_lane_f64(__p0_588, __p1_588, __p2_588) __extension__ ({ \
51713 float64_t __ret_588; \
51714 float64_t __s0_588 = __p0_588; \
51715 float64x1_t __s1_588 = __p1_588; \
51716 __ret_588 = vmulxd_f64(__s0_588, vget_lane_f64(__s1_588, __p2_588)); \
51717 __ret_588; \
51718})
5033451719#ifdef __LITTLE_ENDIAN__
50335#define vcopyq_lane_f32(__p0_371, __p1_371, __p2_371, __p3_371) __extension__ ({ \
50336 float32x4_t __ret_371; \
50337 float32x4_t __s0_371 = __p0_371; \
50338 float32x2_t __s2_371 = __p2_371; \
50339 __ret_371 = vsetq_lane_f32(vget_lane_f32(__s2_371, __p3_371), __s0_371, __p1_371); \
50340 __ret_371; \
51720#define vmulxs_lane_f32(__p0_589, __p1_589, __p2_589) __extension__ ({ \
51721 float32_t __ret_589; \
51722 float32_t __s0_589 = __p0_589; \
51723 float32x2_t __s1_589 = __p1_589; \
51724 __ret_589 = vmulxs_f32(__s0_589, vget_lane_f32(__s1_589, __p2_589)); \
51725 __ret_589; \
5034151726})
5034251727#else
50343#define vcopyq_lane_f32(__p0_372, __p1_372, __p2_372, __p3_372) __extension__ ({ \
50344 float32x4_t __ret_372; \
50345 float32x4_t __s0_372 = __p0_372; \
50346 float32x2_t __s2_372 = __p2_372; \
50347 float32x4_t __rev0_372; __rev0_372 = __builtin_shufflevector(__s0_372, __s0_372, 3, 2, 1, 0); \
50348 float32x2_t __rev2_372; __rev2_372 = __builtin_shufflevector(__s2_372, __s2_372, 1, 0); \
50349 __ret_372 = __noswap_vsetq_lane_f32(__noswap_vget_lane_f32(__rev2_372, __p3_372), __rev0_372, __p1_372); \
50350 __ret_372 = __builtin_shufflevector(__ret_372, __ret_372, 3, 2, 1, 0); \
50351 __ret_372; \
51728#define vmulxs_lane_f32(__p0_590, __p1_590, __p2_590) __extension__ ({ \
51729 float32_t __ret_590; \
51730 float32_t __s0_590 = __p0_590; \
51731 float32x2_t __s1_590 = __p1_590; \
51732 float32x2_t __rev1_590; __rev1_590 = __builtin_shufflevector(__s1_590, __s1_590, 1, 0); \
51733 __ret_590 = vmulxs_f32(__s0_590, __noswap_vget_lane_f32(__rev1_590, __p2_590)); \
51734 __ret_590; \
5035251735})
5035351736#endif
5035451737
5035551738#ifdef __LITTLE_ENDIAN__
50356#define vcopyq_lane_s32(__p0_373, __p1_373, __p2_373, __p3_373) __extension__ ({ \
50357 int32x4_t __ret_373; \
50358 int32x4_t __s0_373 = __p0_373; \
50359 int32x2_t __s2_373 = __p2_373; \
50360 __ret_373 = vsetq_lane_s32(vget_lane_s32(__s2_373, __p3_373), __s0_373, __p1_373); \
50361 __ret_373; \
51739#define vmulxq_lane_f64(__p0_591, __p1_591, __p2_591) __extension__ ({ \
51740 float64x2_t __ret_591; \
51741 float64x2_t __s0_591 = __p0_591; \
51742 float64x1_t __s1_591 = __p1_591; \
51743 __ret_591 = vmulxq_f64(__s0_591, splatq_lane_f64(__s1_591, __p2_591)); \
51744 __ret_591; \
5036251745})
5036351746#else
50364#define vcopyq_lane_s32(__p0_374, __p1_374, __p2_374, __p3_374) __extension__ ({ \
50365 int32x4_t __ret_374; \
50366 int32x4_t __s0_374 = __p0_374; \
50367 int32x2_t __s2_374 = __p2_374; \
50368 int32x4_t __rev0_374; __rev0_374 = __builtin_shufflevector(__s0_374, __s0_374, 3, 2, 1, 0); \
50369 int32x2_t __rev2_374; __rev2_374 = __builtin_shufflevector(__s2_374, __s2_374, 1, 0); \
50370 __ret_374 = __noswap_vsetq_lane_s32(__noswap_vget_lane_s32(__rev2_374, __p3_374), __rev0_374, __p1_374); \
50371 __ret_374 = __builtin_shufflevector(__ret_374, __ret_374, 3, 2, 1, 0); \
50372 __ret_374; \
51747#define vmulxq_lane_f64(__p0_592, __p1_592, __p2_592) __extension__ ({ \
51748 float64x2_t __ret_592; \
51749 float64x2_t __s0_592 = __p0_592; \
51750 float64x1_t __s1_592 = __p1_592; \
51751 float64x2_t __rev0_592; __rev0_592 = __builtin_shufflevector(__s0_592, __s0_592, 1, 0); \
51752 __ret_592 = __noswap_vmulxq_f64(__rev0_592, __noswap_splatq_lane_f64(__s1_592, __p2_592)); \
51753 __ret_592 = __builtin_shufflevector(__ret_592, __ret_592, 1, 0); \
51754 __ret_592; \
5037351755})
5037451756#endif
5037551757
5037651758#ifdef __LITTLE_ENDIAN__
50377#define vcopyq_lane_s64(__p0_375, __p1_375, __p2_375, __p3_375) __extension__ ({ \
50378 int64x2_t __ret_375; \
50379 int64x2_t __s0_375 = __p0_375; \
50380 int64x1_t __s2_375 = __p2_375; \
50381 __ret_375 = vsetq_lane_s64(vget_lane_s64(__s2_375, __p3_375), __s0_375, __p1_375); \
50382 __ret_375; \
51759#define vmulxq_lane_f32(__p0_593, __p1_593, __p2_593) __extension__ ({ \
51760 float32x4_t __ret_593; \
51761 float32x4_t __s0_593 = __p0_593; \
51762 float32x2_t __s1_593 = __p1_593; \
51763 __ret_593 = vmulxq_f32(__s0_593, splatq_lane_f32(__s1_593, __p2_593)); \
51764 __ret_593; \
5038351765})
5038451766#else
50385#define vcopyq_lane_s64(__p0_376, __p1_376, __p2_376, __p3_376) __extension__ ({ \
50386 int64x2_t __ret_376; \
50387 int64x2_t __s0_376 = __p0_376; \
50388 int64x1_t __s2_376 = __p2_376; \
50389 int64x2_t __rev0_376; __rev0_376 = __builtin_shufflevector(__s0_376, __s0_376, 1, 0); \
50390 __ret_376 = __noswap_vsetq_lane_s64(vget_lane_s64(__s2_376, __p3_376), __rev0_376, __p1_376); \
50391 __ret_376 = __builtin_shufflevector(__ret_376, __ret_376, 1, 0); \
50392 __ret_376; \
51767#define vmulxq_lane_f32(__p0_594, __p1_594, __p2_594) __extension__ ({ \
51768 float32x4_t __ret_594; \
51769 float32x4_t __s0_594 = __p0_594; \
51770 float32x2_t __s1_594 = __p1_594; \
51771 float32x4_t __rev0_594; __rev0_594 = __builtin_shufflevector(__s0_594, __s0_594, 3, 2, 1, 0); \
51772 float32x2_t __rev1_594; __rev1_594 = __builtin_shufflevector(__s1_594, __s1_594, 1, 0); \
51773 __ret_594 = __noswap_vmulxq_f32(__rev0_594, __noswap_splatq_lane_f32(__rev1_594, __p2_594)); \
51774 __ret_594 = __builtin_shufflevector(__ret_594, __ret_594, 3, 2, 1, 0); \
51775 __ret_594; \
5039351776})
5039451777#endif
5039551778
5039651779#ifdef __LITTLE_ENDIAN__
50397#define vcopyq_lane_s16(__p0_377, __p1_377, __p2_377, __p3_377) __extension__ ({ \
50398 int16x8_t __ret_377; \
50399 int16x8_t __s0_377 = __p0_377; \
50400 int16x4_t __s2_377 = __p2_377; \
50401 __ret_377 = vsetq_lane_s16(vget_lane_s16(__s2_377, __p3_377), __s0_377, __p1_377); \
50402 __ret_377; \
51780#define vmulx_lane_f32(__p0_595, __p1_595, __p2_595) __extension__ ({ \
51781 float32x2_t __ret_595; \
51782 float32x2_t __s0_595 = __p0_595; \
51783 float32x2_t __s1_595 = __p1_595; \
51784 __ret_595 = vmulx_f32(__s0_595, splat_lane_f32(__s1_595, __p2_595)); \
51785 __ret_595; \
5040351786})
5040451787#else
50405#define vcopyq_lane_s16(__p0_378, __p1_378, __p2_378, __p3_378) __extension__ ({ \
50406 int16x8_t __ret_378; \
50407 int16x8_t __s0_378 = __p0_378; \
50408 int16x4_t __s2_378 = __p2_378; \
50409 int16x8_t __rev0_378; __rev0_378 = __builtin_shufflevector(__s0_378, __s0_378, 7, 6, 5, 4, 3, 2, 1, 0); \
50410 int16x4_t __rev2_378; __rev2_378 = __builtin_shufflevector(__s2_378, __s2_378, 3, 2, 1, 0); \
50411 __ret_378 = __noswap_vsetq_lane_s16(__noswap_vget_lane_s16(__rev2_378, __p3_378), __rev0_378, __p1_378); \
50412 __ret_378 = __builtin_shufflevector(__ret_378, __ret_378, 7, 6, 5, 4, 3, 2, 1, 0); \
50413 __ret_378; \
51788#define vmulx_lane_f32(__p0_596, __p1_596, __p2_596) __extension__ ({ \
51789 float32x2_t __ret_596; \
51790 float32x2_t __s0_596 = __p0_596; \
51791 float32x2_t __s1_596 = __p1_596; \
51792 float32x2_t __rev0_596; __rev0_596 = __builtin_shufflevector(__s0_596, __s0_596, 1, 0); \
51793 float32x2_t __rev1_596; __rev1_596 = __builtin_shufflevector(__s1_596, __s1_596, 1, 0); \
51794 __ret_596 = __noswap_vmulx_f32(__rev0_596, __noswap_splat_lane_f32(__rev1_596, __p2_596)); \
51795 __ret_596 = __builtin_shufflevector(__ret_596, __ret_596, 1, 0); \
51796 __ret_596; \
5041451797})
5041551798#endif
5041651799
5041751800#ifdef __LITTLE_ENDIAN__
50418#define vcopy_lane_p8(__p0_379, __p1_379, __p2_379, __p3_379) __extension__ ({ \
50419 poly8x8_t __ret_379; \
50420 poly8x8_t __s0_379 = __p0_379; \
50421 poly8x8_t __s2_379 = __p2_379; \
50422 __ret_379 = vset_lane_p8(vget_lane_p8(__s2_379, __p3_379), __s0_379, __p1_379); \
50423 __ret_379; \
51801#define vmulxd_laneq_f64(__p0_597, __p1_597, __p2_597) __extension__ ({ \
51802 float64_t __ret_597; \
51803 float64_t __s0_597 = __p0_597; \
51804 float64x2_t __s1_597 = __p1_597; \
51805 __ret_597 = vmulxd_f64(__s0_597, vgetq_lane_f64(__s1_597, __p2_597)); \
51806 __ret_597; \
5042451807})
5042551808#else
50426#define vcopy_lane_p8(__p0_380, __p1_380, __p2_380, __p3_380) __extension__ ({ \
50427 poly8x8_t __ret_380; \
50428 poly8x8_t __s0_380 = __p0_380; \
50429 poly8x8_t __s2_380 = __p2_380; \
50430 poly8x8_t __rev0_380; __rev0_380 = __builtin_shufflevector(__s0_380, __s0_380, 7, 6, 5, 4, 3, 2, 1, 0); \
50431 poly8x8_t __rev2_380; __rev2_380 = __builtin_shufflevector(__s2_380, __s2_380, 7, 6, 5, 4, 3, 2, 1, 0); \
50432 __ret_380 = __noswap_vset_lane_p8(__noswap_vget_lane_p8(__rev2_380, __p3_380), __rev0_380, __p1_380); \
50433 __ret_380 = __builtin_shufflevector(__ret_380, __ret_380, 7, 6, 5, 4, 3, 2, 1, 0); \
50434 __ret_380; \
51809#define vmulxd_laneq_f64(__p0_598, __p1_598, __p2_598) __extension__ ({ \
51810 float64_t __ret_598; \
51811 float64_t __s0_598 = __p0_598; \
51812 float64x2_t __s1_598 = __p1_598; \
51813 float64x2_t __rev1_598; __rev1_598 = __builtin_shufflevector(__s1_598, __s1_598, 1, 0); \
51814 __ret_598 = vmulxd_f64(__s0_598, __noswap_vgetq_lane_f64(__rev1_598, __p2_598)); \
51815 __ret_598; \
5043551816})
5043651817#endif
5043751818
5043851819#ifdef __LITTLE_ENDIAN__
50439#define vcopy_lane_p16(__p0_381, __p1_381, __p2_381, __p3_381) __extension__ ({ \
50440 poly16x4_t __ret_381; \
50441 poly16x4_t __s0_381 = __p0_381; \
50442 poly16x4_t __s2_381 = __p2_381; \
50443 __ret_381 = vset_lane_p16(vget_lane_p16(__s2_381, __p3_381), __s0_381, __p1_381); \
50444 __ret_381; \
51820#define vmulxs_laneq_f32(__p0_599, __p1_599, __p2_599) __extension__ ({ \
51821 float32_t __ret_599; \
51822 float32_t __s0_599 = __p0_599; \
51823 float32x4_t __s1_599 = __p1_599; \
51824 __ret_599 = vmulxs_f32(__s0_599, vgetq_lane_f32(__s1_599, __p2_599)); \
51825 __ret_599; \
5044551826})
5044651827#else
50447#define vcopy_lane_p16(__p0_382, __p1_382, __p2_382, __p3_382) __extension__ ({ \
50448 poly16x4_t __ret_382; \
50449 poly16x4_t __s0_382 = __p0_382; \
50450 poly16x4_t __s2_382 = __p2_382; \
50451 poly16x4_t __rev0_382; __rev0_382 = __builtin_shufflevector(__s0_382, __s0_382, 3, 2, 1, 0); \
50452 poly16x4_t __rev2_382; __rev2_382 = __builtin_shufflevector(__s2_382, __s2_382, 3, 2, 1, 0); \
50453 __ret_382 = __noswap_vset_lane_p16(__noswap_vget_lane_p16(__rev2_382, __p3_382), __rev0_382, __p1_382); \
50454 __ret_382 = __builtin_shufflevector(__ret_382, __ret_382, 3, 2, 1, 0); \
50455 __ret_382; \
51828#define vmulxs_laneq_f32(__p0_600, __p1_600, __p2_600) __extension__ ({ \
51829 float32_t __ret_600; \
51830 float32_t __s0_600 = __p0_600; \
51831 float32x4_t __s1_600 = __p1_600; \
51832 float32x4_t __rev1_600; __rev1_600 = __builtin_shufflevector(__s1_600, __s1_600, 3, 2, 1, 0); \
51833 __ret_600 = vmulxs_f32(__s0_600, __noswap_vgetq_lane_f32(__rev1_600, __p2_600)); \
51834 __ret_600; \
5045651835})
5045751836#endif
5045851837
5045951838#ifdef __LITTLE_ENDIAN__
50460#define vcopy_lane_u8(__p0_383, __p1_383, __p2_383, __p3_383) __extension__ ({ \
50461 uint8x8_t __ret_383; \
50462 uint8x8_t __s0_383 = __p0_383; \
50463 uint8x8_t __s2_383 = __p2_383; \
50464 __ret_383 = vset_lane_u8(vget_lane_u8(__s2_383, __p3_383), __s0_383, __p1_383); \
50465 __ret_383; \
51839#define vmulxq_laneq_f64(__p0_601, __p1_601, __p2_601) __extension__ ({ \
51840 float64x2_t __ret_601; \
51841 float64x2_t __s0_601 = __p0_601; \
51842 float64x2_t __s1_601 = __p1_601; \
51843 __ret_601 = vmulxq_f64(__s0_601, splatq_laneq_f64(__s1_601, __p2_601)); \
51844 __ret_601; \
5046651845})
5046751846#else
50468#define vcopy_lane_u8(__p0_384, __p1_384, __p2_384, __p3_384) __extension__ ({ \
50469 uint8x8_t __ret_384; \
50470 uint8x8_t __s0_384 = __p0_384; \
50471 uint8x8_t __s2_384 = __p2_384; \
50472 uint8x8_t __rev0_384; __rev0_384 = __builtin_shufflevector(__s0_384, __s0_384, 7, 6, 5, 4, 3, 2, 1, 0); \
50473 uint8x8_t __rev2_384; __rev2_384 = __builtin_shufflevector(__s2_384, __s2_384, 7, 6, 5, 4, 3, 2, 1, 0); \
50474 __ret_384 = __noswap_vset_lane_u8(__noswap_vget_lane_u8(__rev2_384, __p3_384), __rev0_384, __p1_384); \
50475 __ret_384 = __builtin_shufflevector(__ret_384, __ret_384, 7, 6, 5, 4, 3, 2, 1, 0); \
50476 __ret_384; \
51847#define vmulxq_laneq_f64(__p0_602, __p1_602, __p2_602) __extension__ ({ \
51848 float64x2_t __ret_602; \
51849 float64x2_t __s0_602 = __p0_602; \
51850 float64x2_t __s1_602 = __p1_602; \
51851 float64x2_t __rev0_602; __rev0_602 = __builtin_shufflevector(__s0_602, __s0_602, 1, 0); \
51852 float64x2_t __rev1_602; __rev1_602 = __builtin_shufflevector(__s1_602, __s1_602, 1, 0); \
51853 __ret_602 = __noswap_vmulxq_f64(__rev0_602, __noswap_splatq_laneq_f64(__rev1_602, __p2_602)); \
51854 __ret_602 = __builtin_shufflevector(__ret_602, __ret_602, 1, 0); \
51855 __ret_602; \
5047751856})
5047851857#endif
5047951858
5048051859#ifdef __LITTLE_ENDIAN__
50481#define vcopy_lane_u32(__p0_385, __p1_385, __p2_385, __p3_385) __extension__ ({ \
50482 uint32x2_t __ret_385; \
50483 uint32x2_t __s0_385 = __p0_385; \
50484 uint32x2_t __s2_385 = __p2_385; \
50485 __ret_385 = vset_lane_u32(vget_lane_u32(__s2_385, __p3_385), __s0_385, __p1_385); \
50486 __ret_385; \
51860#define vmulxq_laneq_f32(__p0_603, __p1_603, __p2_603) __extension__ ({ \
51861 float32x4_t __ret_603; \
51862 float32x4_t __s0_603 = __p0_603; \
51863 float32x4_t __s1_603 = __p1_603; \
51864 __ret_603 = vmulxq_f32(__s0_603, splatq_laneq_f32(__s1_603, __p2_603)); \
51865 __ret_603; \
5048751866})
5048851867#else
50489#define vcopy_lane_u32(__p0_386, __p1_386, __p2_386, __p3_386) __extension__ ({ \
50490 uint32x2_t __ret_386; \
50491 uint32x2_t __s0_386 = __p0_386; \
50492 uint32x2_t __s2_386 = __p2_386; \
50493 uint32x2_t __rev0_386; __rev0_386 = __builtin_shufflevector(__s0_386, __s0_386, 1, 0); \
50494 uint32x2_t __rev2_386; __rev2_386 = __builtin_shufflevector(__s2_386, __s2_386, 1, 0); \
50495 __ret_386 = __noswap_vset_lane_u32(__noswap_vget_lane_u32(__rev2_386, __p3_386), __rev0_386, __p1_386); \
50496 __ret_386 = __builtin_shufflevector(__ret_386, __ret_386, 1, 0); \
50497 __ret_386; \
51868#define vmulxq_laneq_f32(__p0_604, __p1_604, __p2_604) __extension__ ({ \
51869 float32x4_t __ret_604; \
51870 float32x4_t __s0_604 = __p0_604; \
51871 float32x4_t __s1_604 = __p1_604; \
51872 float32x4_t __rev0_604; __rev0_604 = __builtin_shufflevector(__s0_604, __s0_604, 3, 2, 1, 0); \
51873 float32x4_t __rev1_604; __rev1_604 = __builtin_shufflevector(__s1_604, __s1_604, 3, 2, 1, 0); \
51874 __ret_604 = __noswap_vmulxq_f32(__rev0_604, __noswap_splatq_laneq_f32(__rev1_604, __p2_604)); \
51875 __ret_604 = __builtin_shufflevector(__ret_604, __ret_604, 3, 2, 1, 0); \
51876 __ret_604; \
5049851877})
5049951878#endif
5050051879
50501#define vcopy_lane_u64(__p0_387, __p1_387, __p2_387, __p3_387) __extension__ ({ \
50502 uint64x1_t __ret_387; \
50503 uint64x1_t __s0_387 = __p0_387; \
50504 uint64x1_t __s2_387 = __p2_387; \
50505 __ret_387 = vset_lane_u64(vget_lane_u64(__s2_387, __p3_387), __s0_387, __p1_387); \
50506 __ret_387; \
50507})
5050851880#ifdef __LITTLE_ENDIAN__
50509#define vcopy_lane_u16(__p0_388, __p1_388, __p2_388, __p3_388) __extension__ ({ \
50510 uint16x4_t __ret_388; \
50511 uint16x4_t __s0_388 = __p0_388; \
50512 uint16x4_t __s2_388 = __p2_388; \
50513 __ret_388 = vset_lane_u16(vget_lane_u16(__s2_388, __p3_388), __s0_388, __p1_388); \
50514 __ret_388; \
51881#define vmulx_laneq_f32(__p0_605, __p1_605, __p2_605) __extension__ ({ \
51882 float32x2_t __ret_605; \
51883 float32x2_t __s0_605 = __p0_605; \
51884 float32x4_t __s1_605 = __p1_605; \
51885 __ret_605 = vmulx_f32(__s0_605, splat_laneq_f32(__s1_605, __p2_605)); \
51886 __ret_605; \
5051551887})
5051651888#else
50517#define vcopy_lane_u16(__p0_389, __p1_389, __p2_389, __p3_389) __extension__ ({ \
50518 uint16x4_t __ret_389; \
50519 uint16x4_t __s0_389 = __p0_389; \
50520 uint16x4_t __s2_389 = __p2_389; \
50521 uint16x4_t __rev0_389; __rev0_389 = __builtin_shufflevector(__s0_389, __s0_389, 3, 2, 1, 0); \
50522 uint16x4_t __rev2_389; __rev2_389 = __builtin_shufflevector(__s2_389, __s2_389, 3, 2, 1, 0); \
50523 __ret_389 = __noswap_vset_lane_u16(__noswap_vget_lane_u16(__rev2_389, __p3_389), __rev0_389, __p1_389); \
50524 __ret_389 = __builtin_shufflevector(__ret_389, __ret_389, 3, 2, 1, 0); \
50525 __ret_389; \
51889#define vmulx_laneq_f32(__p0_606, __p1_606, __p2_606) __extension__ ({ \
51890 float32x2_t __ret_606; \
51891 float32x2_t __s0_606 = __p0_606; \
51892 float32x4_t __s1_606 = __p1_606; \
51893 float32x2_t __rev0_606; __rev0_606 = __builtin_shufflevector(__s0_606, __s0_606, 1, 0); \
51894 float32x4_t __rev1_606; __rev1_606 = __builtin_shufflevector(__s1_606, __s1_606, 3, 2, 1, 0); \
51895 __ret_606 = __noswap_vmulx_f32(__rev0_606, __noswap_splat_laneq_f32(__rev1_606, __p2_606)); \
51896 __ret_606 = __builtin_shufflevector(__ret_606, __ret_606, 1, 0); \
51897 __ret_606; \
5052651898})
5052751899#endif
5052851900
5052951901#ifdef __LITTLE_ENDIAN__
50530#define vcopy_lane_s8(__p0_390, __p1_390, __p2_390, __p3_390) __extension__ ({ \
50531 int8x8_t __ret_390; \
50532 int8x8_t __s0_390 = __p0_390; \
50533 int8x8_t __s2_390 = __p2_390; \
50534 __ret_390 = vset_lane_s8(vget_lane_s8(__s2_390, __p3_390), __s0_390, __p1_390); \
50535 __ret_390; \
50536})
51902__ai float64x2_t vnegq_f64(float64x2_t __p0) {
51903 float64x2_t __ret;
51904 __ret = -__p0;
51905 return __ret;
51906}
5053751907#else
50538#define vcopy_lane_s8(__p0_391, __p1_391, __p2_391, __p3_391) __extension__ ({ \
50539 int8x8_t __ret_391; \
50540 int8x8_t __s0_391 = __p0_391; \
50541 int8x8_t __s2_391 = __p2_391; \
50542 int8x8_t __rev0_391; __rev0_391 = __builtin_shufflevector(__s0_391, __s0_391, 7, 6, 5, 4, 3, 2, 1, 0); \
50543 int8x8_t __rev2_391; __rev2_391 = __builtin_shufflevector(__s2_391, __s2_391, 7, 6, 5, 4, 3, 2, 1, 0); \
50544 __ret_391 = __noswap_vset_lane_s8(__noswap_vget_lane_s8(__rev2_391, __p3_391), __rev0_391, __p1_391); \
50545 __ret_391 = __builtin_shufflevector(__ret_391, __ret_391, 7, 6, 5, 4, 3, 2, 1, 0); \
50546 __ret_391; \
50547})
51908__ai float64x2_t vnegq_f64(float64x2_t __p0) {
51909 float64x2_t __ret;
51910 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
51911 __ret = -__rev0;
51912 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
51913 return __ret;
51914}
5054851915#endif
5054951916
5055051917#ifdef __LITTLE_ENDIAN__
50551#define vcopy_lane_f32(__p0_392, __p1_392, __p2_392, __p3_392) __extension__ ({ \
50552 float32x2_t __ret_392; \
50553 float32x2_t __s0_392 = __p0_392; \
50554 float32x2_t __s2_392 = __p2_392; \
50555 __ret_392 = vset_lane_f32(vget_lane_f32(__s2_392, __p3_392), __s0_392, __p1_392); \
50556 __ret_392; \
50557})
51918__ai int64x2_t vnegq_s64(int64x2_t __p0) {
51919 int64x2_t __ret;
51920 __ret = -__p0;
51921 return __ret;
51922}
5055851923#else
50559#define vcopy_lane_f32(__p0_393, __p1_393, __p2_393, __p3_393) __extension__ ({ \
50560 float32x2_t __ret_393; \
50561 float32x2_t __s0_393 = __p0_393; \
50562 float32x2_t __s2_393 = __p2_393; \
50563 float32x2_t __rev0_393; __rev0_393 = __builtin_shufflevector(__s0_393, __s0_393, 1, 0); \
50564 float32x2_t __rev2_393; __rev2_393 = __builtin_shufflevector(__s2_393, __s2_393, 1, 0); \
50565 __ret_393 = __noswap_vset_lane_f32(__noswap_vget_lane_f32(__rev2_393, __p3_393), __rev0_393, __p1_393); \
50566 __ret_393 = __builtin_shufflevector(__ret_393, __ret_393, 1, 0); \
50567 __ret_393; \
50568})
51924__ai int64x2_t vnegq_s64(int64x2_t __p0) {
51925 int64x2_t __ret;
51926 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
51927 __ret = -__rev0;
51928 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
51929 return __ret;
51930}
51931#endif
51932
51933__ai float64x1_t vneg_f64(float64x1_t __p0) {
51934 float64x1_t __ret;
51935 __ret = -__p0;
51936 return __ret;
51937}
51938__ai int64x1_t vneg_s64(int64x1_t __p0) {
51939 int64x1_t __ret;
51940 __ret = -__p0;
51941 return __ret;
51942}
51943__ai int64_t vnegd_s64(int64_t __p0) {
51944 int64_t __ret;
51945 __ret = (int64_t) __builtin_neon_vnegd_s64(__p0);
51946 return __ret;
51947}
51948#ifdef __LITTLE_ENDIAN__
51949__ai uint8x16_t vpaddq_u8(uint8x16_t __p0, uint8x16_t __p1) {
51950 uint8x16_t __ret;
51951 __ret = (uint8x16_t) __builtin_neon_vpaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 48);
51952 return __ret;
51953}
51954#else
51955__ai uint8x16_t vpaddq_u8(uint8x16_t __p0, uint8x16_t __p1) {
51956 uint8x16_t __ret;
51957 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
51958 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
51959 __ret = (uint8x16_t) __builtin_neon_vpaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 48);
51960 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
51961 return __ret;
51962}
5056951963#endif
5057051964
5057151965#ifdef __LITTLE_ENDIAN__
50572#define vcopy_lane_s32(__p0_394, __p1_394, __p2_394, __p3_394) __extension__ ({ \
50573 int32x2_t __ret_394; \
50574 int32x2_t __s0_394 = __p0_394; \
50575 int32x2_t __s2_394 = __p2_394; \
50576 __ret_394 = vset_lane_s32(vget_lane_s32(__s2_394, __p3_394), __s0_394, __p1_394); \
50577 __ret_394; \
50578})
51966__ai uint32x4_t vpaddq_u32(uint32x4_t __p0, uint32x4_t __p1) {
51967 uint32x4_t __ret;
51968 __ret = (uint32x4_t) __builtin_neon_vpaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 50);
51969 return __ret;
51970}
5057951971#else
50580#define vcopy_lane_s32(__p0_395, __p1_395, __p2_395, __p3_395) __extension__ ({ \
50581 int32x2_t __ret_395; \
50582 int32x2_t __s0_395 = __p0_395; \
50583 int32x2_t __s2_395 = __p2_395; \
50584 int32x2_t __rev0_395; __rev0_395 = __builtin_shufflevector(__s0_395, __s0_395, 1, 0); \
50585 int32x2_t __rev2_395; __rev2_395 = __builtin_shufflevector(__s2_395, __s2_395, 1, 0); \
50586 __ret_395 = __noswap_vset_lane_s32(__noswap_vget_lane_s32(__rev2_395, __p3_395), __rev0_395, __p1_395); \
50587 __ret_395 = __builtin_shufflevector(__ret_395, __ret_395, 1, 0); \
50588 __ret_395; \
50589})
51972__ai uint32x4_t vpaddq_u32(uint32x4_t __p0, uint32x4_t __p1) {
51973 uint32x4_t __ret;
51974 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
51975 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
51976 __ret = (uint32x4_t) __builtin_neon_vpaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 50);
51977 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
51978 return __ret;
51979}
5059051980#endif
5059151981
50592#define vcopy_lane_s64(__p0_396, __p1_396, __p2_396, __p3_396) __extension__ ({ \
50593 int64x1_t __ret_396; \
50594 int64x1_t __s0_396 = __p0_396; \
50595 int64x1_t __s2_396 = __p2_396; \
50596 __ret_396 = vset_lane_s64(vget_lane_s64(__s2_396, __p3_396), __s0_396, __p1_396); \
50597 __ret_396; \
50598})
5059951982#ifdef __LITTLE_ENDIAN__
50600#define vcopy_lane_s16(__p0_397, __p1_397, __p2_397, __p3_397) __extension__ ({ \
50601 int16x4_t __ret_397; \
50602 int16x4_t __s0_397 = __p0_397; \
50603 int16x4_t __s2_397 = __p2_397; \
50604 __ret_397 = vset_lane_s16(vget_lane_s16(__s2_397, __p3_397), __s0_397, __p1_397); \
50605 __ret_397; \
50606})
51983__ai uint64x2_t vpaddq_u64(uint64x2_t __p0, uint64x2_t __p1) {
51984 uint64x2_t __ret;
51985 __ret = (uint64x2_t) __builtin_neon_vpaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 51);
51986 return __ret;
51987}
5060751988#else
50608#define vcopy_lane_s16(__p0_398, __p1_398, __p2_398, __p3_398) __extension__ ({ \
50609 int16x4_t __ret_398; \
50610 int16x4_t __s0_398 = __p0_398; \
50611 int16x4_t __s2_398 = __p2_398; \
50612 int16x4_t __rev0_398; __rev0_398 = __builtin_shufflevector(__s0_398, __s0_398, 3, 2, 1, 0); \
50613 int16x4_t __rev2_398; __rev2_398 = __builtin_shufflevector(__s2_398, __s2_398, 3, 2, 1, 0); \
50614 __ret_398 = __noswap_vset_lane_s16(__noswap_vget_lane_s16(__rev2_398, __p3_398), __rev0_398, __p1_398); \
50615 __ret_398 = __builtin_shufflevector(__ret_398, __ret_398, 3, 2, 1, 0); \
50616 __ret_398; \
50617})
51989__ai uint64x2_t vpaddq_u64(uint64x2_t __p0, uint64x2_t __p1) {
51990 uint64x2_t __ret;
51991 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
51992 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
51993 __ret = (uint64x2_t) __builtin_neon_vpaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 51);
51994 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
51995 return __ret;
51996}
5061851997#endif
5061951998
5062051999#ifdef __LITTLE_ENDIAN__
50621#define vcopyq_laneq_p8(__p0_399, __p1_399, __p2_399, __p3_399) __extension__ ({ \
50622 poly8x16_t __ret_399; \
50623 poly8x16_t __s0_399 = __p0_399; \
50624 poly8x16_t __s2_399 = __p2_399; \
50625 __ret_399 = vsetq_lane_p8(vgetq_lane_p8(__s2_399, __p3_399), __s0_399, __p1_399); \
50626 __ret_399; \
50627})
52000__ai uint16x8_t vpaddq_u16(uint16x8_t __p0, uint16x8_t __p1) {
52001 uint16x8_t __ret;
52002 __ret = (uint16x8_t) __builtin_neon_vpaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 49);
52003 return __ret;
52004}
5062852005#else
50629#define vcopyq_laneq_p8(__p0_400, __p1_400, __p2_400, __p3_400) __extension__ ({ \
50630 poly8x16_t __ret_400; \
50631 poly8x16_t __s0_400 = __p0_400; \
50632 poly8x16_t __s2_400 = __p2_400; \
50633 poly8x16_t __rev0_400; __rev0_400 = __builtin_shufflevector(__s0_400, __s0_400, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
50634 poly8x16_t __rev2_400; __rev2_400 = __builtin_shufflevector(__s2_400, __s2_400, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
50635 __ret_400 = __noswap_vsetq_lane_p8(__noswap_vgetq_lane_p8(__rev2_400, __p3_400), __rev0_400, __p1_400); \
50636 __ret_400 = __builtin_shufflevector(__ret_400, __ret_400, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
50637 __ret_400; \
50638})
52006__ai uint16x8_t vpaddq_u16(uint16x8_t __p0, uint16x8_t __p1) {
52007 uint16x8_t __ret;
52008 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
52009 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
52010 __ret = (uint16x8_t) __builtin_neon_vpaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 49);
52011 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
52012 return __ret;
52013}
5063952014#endif
5064052015
5064152016#ifdef __LITTLE_ENDIAN__
50642#define vcopyq_laneq_p16(__p0_401, __p1_401, __p2_401, __p3_401) __extension__ ({ \
50643 poly16x8_t __ret_401; \
50644 poly16x8_t __s0_401 = __p0_401; \
50645 poly16x8_t __s2_401 = __p2_401; \
50646 __ret_401 = vsetq_lane_p16(vgetq_lane_p16(__s2_401, __p3_401), __s0_401, __p1_401); \
50647 __ret_401; \
50648})
52017__ai int8x16_t vpaddq_s8(int8x16_t __p0, int8x16_t __p1) {
52018 int8x16_t __ret;
52019 __ret = (int8x16_t) __builtin_neon_vpaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 32);
52020 return __ret;
52021}
5064952022#else
50650#define vcopyq_laneq_p16(__p0_402, __p1_402, __p2_402, __p3_402) __extension__ ({ \
50651 poly16x8_t __ret_402; \
50652 poly16x8_t __s0_402 = __p0_402; \
50653 poly16x8_t __s2_402 = __p2_402; \
50654 poly16x8_t __rev0_402; __rev0_402 = __builtin_shufflevector(__s0_402, __s0_402, 7, 6, 5, 4, 3, 2, 1, 0); \
50655 poly16x8_t __rev2_402; __rev2_402 = __builtin_shufflevector(__s2_402, __s2_402, 7, 6, 5, 4, 3, 2, 1, 0); \
50656 __ret_402 = __noswap_vsetq_lane_p16(__noswap_vgetq_lane_p16(__rev2_402, __p3_402), __rev0_402, __p1_402); \
50657 __ret_402 = __builtin_shufflevector(__ret_402, __ret_402, 7, 6, 5, 4, 3, 2, 1, 0); \
50658 __ret_402; \
50659})
52023__ai int8x16_t vpaddq_s8(int8x16_t __p0, int8x16_t __p1) {
52024 int8x16_t __ret;
52025 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
52026 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
52027 __ret = (int8x16_t) __builtin_neon_vpaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 32);
52028 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
52029 return __ret;
52030}
5066052031#endif
5066152032
5066252033#ifdef __LITTLE_ENDIAN__
50663#define vcopyq_laneq_u8(__p0_403, __p1_403, __p2_403, __p3_403) __extension__ ({ \
50664 uint8x16_t __ret_403; \
50665 uint8x16_t __s0_403 = __p0_403; \
50666 uint8x16_t __s2_403 = __p2_403; \
50667 __ret_403 = vsetq_lane_u8(vgetq_lane_u8(__s2_403, __p3_403), __s0_403, __p1_403); \
50668 __ret_403; \
50669})
52034__ai float64x2_t vpaddq_f64(float64x2_t __p0, float64x2_t __p1) {
52035 float64x2_t __ret;
52036 __ret = (float64x2_t) __builtin_neon_vpaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
52037 return __ret;
52038}
5067052039#else
50671#define vcopyq_laneq_u8(__p0_404, __p1_404, __p2_404, __p3_404) __extension__ ({ \
50672 uint8x16_t __ret_404; \
50673 uint8x16_t __s0_404 = __p0_404; \
50674 uint8x16_t __s2_404 = __p2_404; \
50675 uint8x16_t __rev0_404; __rev0_404 = __builtin_shufflevector(__s0_404, __s0_404, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
50676 uint8x16_t __rev2_404; __rev2_404 = __builtin_shufflevector(__s2_404, __s2_404, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
50677 __ret_404 = __noswap_vsetq_lane_u8(__noswap_vgetq_lane_u8(__rev2_404, __p3_404), __rev0_404, __p1_404); \
50678 __ret_404 = __builtin_shufflevector(__ret_404, __ret_404, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
50679 __ret_404; \
50680})
52040__ai float64x2_t vpaddq_f64(float64x2_t __p0, float64x2_t __p1) {
52041 float64x2_t __ret;
52042 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
52043 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
52044 __ret = (float64x2_t) __builtin_neon_vpaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
52045 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
52046 return __ret;
52047}
5068152048#endif
5068252049
5068352050#ifdef __LITTLE_ENDIAN__
50684#define vcopyq_laneq_u32(__p0_405, __p1_405, __p2_405, __p3_405) __extension__ ({ \
50685 uint32x4_t __ret_405; \
50686 uint32x4_t __s0_405 = __p0_405; \
50687 uint32x4_t __s2_405 = __p2_405; \
50688 __ret_405 = vsetq_lane_u32(vgetq_lane_u32(__s2_405, __p3_405), __s0_405, __p1_405); \
50689 __ret_405; \
50690})
52051__ai float32x4_t vpaddq_f32(float32x4_t __p0, float32x4_t __p1) {
52052 float32x4_t __ret;
52053 __ret = (float32x4_t) __builtin_neon_vpaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 41);
52054 return __ret;
52055}
5069152056#else
50692#define vcopyq_laneq_u32(__p0_406, __p1_406, __p2_406, __p3_406) __extension__ ({ \
50693 uint32x4_t __ret_406; \
50694 uint32x4_t __s0_406 = __p0_406; \
50695 uint32x4_t __s2_406 = __p2_406; \
50696 uint32x4_t __rev0_406; __rev0_406 = __builtin_shufflevector(__s0_406, __s0_406, 3, 2, 1, 0); \
50697 uint32x4_t __rev2_406; __rev2_406 = __builtin_shufflevector(__s2_406, __s2_406, 3, 2, 1, 0); \
50698 __ret_406 = __noswap_vsetq_lane_u32(__noswap_vgetq_lane_u32(__rev2_406, __p3_406), __rev0_406, __p1_406); \
50699 __ret_406 = __builtin_shufflevector(__ret_406, __ret_406, 3, 2, 1, 0); \
50700 __ret_406; \
50701})
52057__ai float32x4_t vpaddq_f32(float32x4_t __p0, float32x4_t __p1) {
52058 float32x4_t __ret;
52059 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
52060 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
52061 __ret = (float32x4_t) __builtin_neon_vpaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 41);
52062 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
52063 return __ret;
52064}
5070252065#endif
5070352066
5070452067#ifdef __LITTLE_ENDIAN__
50705#define vcopyq_laneq_u64(__p0_407, __p1_407, __p2_407, __p3_407) __extension__ ({ \
50706 uint64x2_t __ret_407; \
50707 uint64x2_t __s0_407 = __p0_407; \
50708 uint64x2_t __s2_407 = __p2_407; \
50709 __ret_407 = vsetq_lane_u64(vgetq_lane_u64(__s2_407, __p3_407), __s0_407, __p1_407); \
50710 __ret_407; \
50711})
52068__ai int32x4_t vpaddq_s32(int32x4_t __p0, int32x4_t __p1) {
52069 int32x4_t __ret;
52070 __ret = (int32x4_t) __builtin_neon_vpaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 34);
52071 return __ret;
52072}
5071252073#else
50713#define vcopyq_laneq_u64(__p0_408, __p1_408, __p2_408, __p3_408) __extension__ ({ \
50714 uint64x2_t __ret_408; \
50715 uint64x2_t __s0_408 = __p0_408; \
50716 uint64x2_t __s2_408 = __p2_408; \
50717 uint64x2_t __rev0_408; __rev0_408 = __builtin_shufflevector(__s0_408, __s0_408, 1, 0); \
50718 uint64x2_t __rev2_408; __rev2_408 = __builtin_shufflevector(__s2_408, __s2_408, 1, 0); \
50719 __ret_408 = __noswap_vsetq_lane_u64(__noswap_vgetq_lane_u64(__rev2_408, __p3_408), __rev0_408, __p1_408); \
50720 __ret_408 = __builtin_shufflevector(__ret_408, __ret_408, 1, 0); \
50721 __ret_408; \
50722})
52074__ai int32x4_t vpaddq_s32(int32x4_t __p0, int32x4_t __p1) {
52075 int32x4_t __ret;
52076 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
52077 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
52078 __ret = (int32x4_t) __builtin_neon_vpaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 34);
52079 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
52080 return __ret;
52081}
5072352082#endif
5072452083
5072552084#ifdef __LITTLE_ENDIAN__
50726#define vcopyq_laneq_u16(__p0_409, __p1_409, __p2_409, __p3_409) __extension__ ({ \
50727 uint16x8_t __ret_409; \
50728 uint16x8_t __s0_409 = __p0_409; \
50729 uint16x8_t __s2_409 = __p2_409; \
50730 __ret_409 = vsetq_lane_u16(vgetq_lane_u16(__s2_409, __p3_409), __s0_409, __p1_409); \
50731 __ret_409; \
50732})
52085__ai int64x2_t vpaddq_s64(int64x2_t __p0, int64x2_t __p1) {
52086 int64x2_t __ret;
52087 __ret = (int64x2_t) __builtin_neon_vpaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 35);
52088 return __ret;
52089}
5073352090#else
50734#define vcopyq_laneq_u16(__p0_410, __p1_410, __p2_410, __p3_410) __extension__ ({ \
50735 uint16x8_t __ret_410; \
50736 uint16x8_t __s0_410 = __p0_410; \
50737 uint16x8_t __s2_410 = __p2_410; \
50738 uint16x8_t __rev0_410; __rev0_410 = __builtin_shufflevector(__s0_410, __s0_410, 7, 6, 5, 4, 3, 2, 1, 0); \
50739 uint16x8_t __rev2_410; __rev2_410 = __builtin_shufflevector(__s2_410, __s2_410, 7, 6, 5, 4, 3, 2, 1, 0); \
50740 __ret_410 = __noswap_vsetq_lane_u16(__noswap_vgetq_lane_u16(__rev2_410, __p3_410), __rev0_410, __p1_410); \
50741 __ret_410 = __builtin_shufflevector(__ret_410, __ret_410, 7, 6, 5, 4, 3, 2, 1, 0); \
50742 __ret_410; \
50743})
52091__ai int64x2_t vpaddq_s64(int64x2_t __p0, int64x2_t __p1) {
52092 int64x2_t __ret;
52093 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
52094 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
52095 __ret = (int64x2_t) __builtin_neon_vpaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 35);
52096 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
52097 return __ret;
52098}
5074452099#endif
5074552100
5074652101#ifdef __LITTLE_ENDIAN__
50747#define vcopyq_laneq_s8(__p0_411, __p1_411, __p2_411, __p3_411) __extension__ ({ \
50748 int8x16_t __ret_411; \
50749 int8x16_t __s0_411 = __p0_411; \
50750 int8x16_t __s2_411 = __p2_411; \
50751 __ret_411 = vsetq_lane_s8(vgetq_lane_s8(__s2_411, __p3_411), __s0_411, __p1_411); \
50752 __ret_411; \
50753})
52102__ai int16x8_t vpaddq_s16(int16x8_t __p0, int16x8_t __p1) {
52103 int16x8_t __ret;
52104 __ret = (int16x8_t) __builtin_neon_vpaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 33);
52105 return __ret;
52106}
5075452107#else
50755#define vcopyq_laneq_s8(__p0_412, __p1_412, __p2_412, __p3_412) __extension__ ({ \
50756 int8x16_t __ret_412; \
50757 int8x16_t __s0_412 = __p0_412; \
50758 int8x16_t __s2_412 = __p2_412; \
50759 int8x16_t __rev0_412; __rev0_412 = __builtin_shufflevector(__s0_412, __s0_412, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
50760 int8x16_t __rev2_412; __rev2_412 = __builtin_shufflevector(__s2_412, __s2_412, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
50761 __ret_412 = __noswap_vsetq_lane_s8(__noswap_vgetq_lane_s8(__rev2_412, __p3_412), __rev0_412, __p1_412); \
50762 __ret_412 = __builtin_shufflevector(__ret_412, __ret_412, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
50763 __ret_412; \
50764})
52108__ai int16x8_t vpaddq_s16(int16x8_t __p0, int16x8_t __p1) {
52109 int16x8_t __ret;
52110 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
52111 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
52112 __ret = (int16x8_t) __builtin_neon_vpaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 33);
52113 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
52114 return __ret;
52115}
5076552116#endif
5076652117
5076752118#ifdef __LITTLE_ENDIAN__
50768#define vcopyq_laneq_f32(__p0_413, __p1_413, __p2_413, __p3_413) __extension__ ({ \
50769 float32x4_t __ret_413; \
50770 float32x4_t __s0_413 = __p0_413; \
50771 float32x4_t __s2_413 = __p2_413; \
50772 __ret_413 = vsetq_lane_f32(vgetq_lane_f32(__s2_413, __p3_413), __s0_413, __p1_413); \
50773 __ret_413; \
50774})
52119__ai uint64_t vpaddd_u64(uint64x2_t __p0) {
52120 uint64_t __ret;
52121 __ret = (uint64_t) __builtin_neon_vpaddd_u64(__p0);
52122 return __ret;
52123}
5077552124#else
50776#define vcopyq_laneq_f32(__p0_414, __p1_414, __p2_414, __p3_414) __extension__ ({ \
50777 float32x4_t __ret_414; \
50778 float32x4_t __s0_414 = __p0_414; \
50779 float32x4_t __s2_414 = __p2_414; \
50780 float32x4_t __rev0_414; __rev0_414 = __builtin_shufflevector(__s0_414, __s0_414, 3, 2, 1, 0); \
50781 float32x4_t __rev2_414; __rev2_414 = __builtin_shufflevector(__s2_414, __s2_414, 3, 2, 1, 0); \
50782 __ret_414 = __noswap_vsetq_lane_f32(__noswap_vgetq_lane_f32(__rev2_414, __p3_414), __rev0_414, __p1_414); \
50783 __ret_414 = __builtin_shufflevector(__ret_414, __ret_414, 3, 2, 1, 0); \
50784 __ret_414; \
50785})
52125__ai uint64_t vpaddd_u64(uint64x2_t __p0) {
52126 uint64_t __ret;
52127 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
52128 __ret = (uint64_t) __builtin_neon_vpaddd_u64(__rev0);
52129 return __ret;
52130}
5078652131#endif
5078752132
5078852133#ifdef __LITTLE_ENDIAN__
50789#define vcopyq_laneq_s32(__p0_415, __p1_415, __p2_415, __p3_415) __extension__ ({ \
50790 int32x4_t __ret_415; \
50791 int32x4_t __s0_415 = __p0_415; \
50792 int32x4_t __s2_415 = __p2_415; \
50793 __ret_415 = vsetq_lane_s32(vgetq_lane_s32(__s2_415, __p3_415), __s0_415, __p1_415); \
50794 __ret_415; \
50795})
52134__ai float64_t vpaddd_f64(float64x2_t __p0) {
52135 float64_t __ret;
52136 __ret = (float64_t) __builtin_neon_vpaddd_f64(__p0);
52137 return __ret;
52138}
5079652139#else
50797#define vcopyq_laneq_s32(__p0_416, __p1_416, __p2_416, __p3_416) __extension__ ({ \
50798 int32x4_t __ret_416; \
50799 int32x4_t __s0_416 = __p0_416; \
50800 int32x4_t __s2_416 = __p2_416; \
50801 int32x4_t __rev0_416; __rev0_416 = __builtin_shufflevector(__s0_416, __s0_416, 3, 2, 1, 0); \
50802 int32x4_t __rev2_416; __rev2_416 = __builtin_shufflevector(__s2_416, __s2_416, 3, 2, 1, 0); \
50803 __ret_416 = __noswap_vsetq_lane_s32(__noswap_vgetq_lane_s32(__rev2_416, __p3_416), __rev0_416, __p1_416); \
50804 __ret_416 = __builtin_shufflevector(__ret_416, __ret_416, 3, 2, 1, 0); \
50805 __ret_416; \
50806})
52140__ai float64_t vpaddd_f64(float64x2_t __p0) {
52141 float64_t __ret;
52142 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
52143 __ret = (float64_t) __builtin_neon_vpaddd_f64(__rev0);
52144 return __ret;
52145}
5080752146#endif
5080852147
5080952148#ifdef __LITTLE_ENDIAN__
50810#define vcopyq_laneq_s64(__p0_417, __p1_417, __p2_417, __p3_417) __extension__ ({ \
50811 int64x2_t __ret_417; \
50812 int64x2_t __s0_417 = __p0_417; \
50813 int64x2_t __s2_417 = __p2_417; \
50814 __ret_417 = vsetq_lane_s64(vgetq_lane_s64(__s2_417, __p3_417), __s0_417, __p1_417); \
50815 __ret_417; \
50816})
52149__ai int64_t vpaddd_s64(int64x2_t __p0) {
52150 int64_t __ret;
52151 __ret = (int64_t) __builtin_neon_vpaddd_s64(__p0);
52152 return __ret;
52153}
5081752154#else
50818#define vcopyq_laneq_s64(__p0_418, __p1_418, __p2_418, __p3_418) __extension__ ({ \
50819 int64x2_t __ret_418; \
50820 int64x2_t __s0_418 = __p0_418; \
50821 int64x2_t __s2_418 = __p2_418; \
50822 int64x2_t __rev0_418; __rev0_418 = __builtin_shufflevector(__s0_418, __s0_418, 1, 0); \
50823 int64x2_t __rev2_418; __rev2_418 = __builtin_shufflevector(__s2_418, __s2_418, 1, 0); \
50824 __ret_418 = __noswap_vsetq_lane_s64(__noswap_vgetq_lane_s64(__rev2_418, __p3_418), __rev0_418, __p1_418); \
50825 __ret_418 = __builtin_shufflevector(__ret_418, __ret_418, 1, 0); \
50826 __ret_418; \
50827})
52155__ai int64_t vpaddd_s64(int64x2_t __p0) {
52156 int64_t __ret;
52157 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
52158 __ret = (int64_t) __builtin_neon_vpaddd_s64(__rev0);
52159 return __ret;
52160}
5082852161#endif
5082952162
5083052163#ifdef __LITTLE_ENDIAN__
50831#define vcopyq_laneq_s16(__p0_419, __p1_419, __p2_419, __p3_419) __extension__ ({ \
50832 int16x8_t __ret_419; \
50833 int16x8_t __s0_419 = __p0_419; \
50834 int16x8_t __s2_419 = __p2_419; \
50835 __ret_419 = vsetq_lane_s16(vgetq_lane_s16(__s2_419, __p3_419), __s0_419, __p1_419); \
50836 __ret_419; \
50837})
52164__ai float32_t vpadds_f32(float32x2_t __p0) {
52165 float32_t __ret;
52166 __ret = (float32_t) __builtin_neon_vpadds_f32(__p0);
52167 return __ret;
52168}
5083852169#else
50839#define vcopyq_laneq_s16(__p0_420, __p1_420, __p2_420, __p3_420) __extension__ ({ \
50840 int16x8_t __ret_420; \
50841 int16x8_t __s0_420 = __p0_420; \
50842 int16x8_t __s2_420 = __p2_420; \
50843 int16x8_t __rev0_420; __rev0_420 = __builtin_shufflevector(__s0_420, __s0_420, 7, 6, 5, 4, 3, 2, 1, 0); \
50844 int16x8_t __rev2_420; __rev2_420 = __builtin_shufflevector(__s2_420, __s2_420, 7, 6, 5, 4, 3, 2, 1, 0); \
50845 __ret_420 = __noswap_vsetq_lane_s16(__noswap_vgetq_lane_s16(__rev2_420, __p3_420), __rev0_420, __p1_420); \
50846 __ret_420 = __builtin_shufflevector(__ret_420, __ret_420, 7, 6, 5, 4, 3, 2, 1, 0); \
50847 __ret_420; \
50848})
52170__ai float32_t vpadds_f32(float32x2_t __p0) {
52171 float32_t __ret;
52172 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
52173 __ret = (float32_t) __builtin_neon_vpadds_f32(__rev0);
52174 return __ret;
52175}
5084952176#endif
5085052177
5085152178#ifdef __LITTLE_ENDIAN__
50852#define vcopy_laneq_p8(__p0_421, __p1_421, __p2_421, __p3_421) __extension__ ({ \
50853 poly8x8_t __ret_421; \
50854 poly8x8_t __s0_421 = __p0_421; \
50855 poly8x16_t __s2_421 = __p2_421; \
50856 __ret_421 = vset_lane_p8(vgetq_lane_p8(__s2_421, __p3_421), __s0_421, __p1_421); \
50857 __ret_421; \
50858})
52179__ai uint8x16_t vpmaxq_u8(uint8x16_t __p0, uint8x16_t __p1) {
52180 uint8x16_t __ret;
52181 __ret = (uint8x16_t) __builtin_neon_vpmaxq_v((int8x16_t)__p0, (int8x16_t)__p1, 48);
52182 return __ret;
52183}
5085952184#else
50860#define vcopy_laneq_p8(__p0_422, __p1_422, __p2_422, __p3_422) __extension__ ({ \
50861 poly8x8_t __ret_422; \
50862 poly8x8_t __s0_422 = __p0_422; \
50863 poly8x16_t __s2_422 = __p2_422; \
50864 poly8x8_t __rev0_422; __rev0_422 = __builtin_shufflevector(__s0_422, __s0_422, 7, 6, 5, 4, 3, 2, 1, 0); \
50865 poly8x16_t __rev2_422; __rev2_422 = __builtin_shufflevector(__s2_422, __s2_422, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
50866 __ret_422 = __noswap_vset_lane_p8(__noswap_vgetq_lane_p8(__rev2_422, __p3_422), __rev0_422, __p1_422); \
50867 __ret_422 = __builtin_shufflevector(__ret_422, __ret_422, 7, 6, 5, 4, 3, 2, 1, 0); \
50868 __ret_422; \
50869})
52185__ai uint8x16_t vpmaxq_u8(uint8x16_t __p0, uint8x16_t __p1) {
52186 uint8x16_t __ret;
52187 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
52188 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
52189 __ret = (uint8x16_t) __builtin_neon_vpmaxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 48);
52190 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
52191 return __ret;
52192}
5087052193#endif
5087152194
5087252195#ifdef __LITTLE_ENDIAN__
50873#define vcopy_laneq_p16(__p0_423, __p1_423, __p2_423, __p3_423) __extension__ ({ \
50874 poly16x4_t __ret_423; \
50875 poly16x4_t __s0_423 = __p0_423; \
50876 poly16x8_t __s2_423 = __p2_423; \
50877 __ret_423 = vset_lane_p16(vgetq_lane_p16(__s2_423, __p3_423), __s0_423, __p1_423); \
50878 __ret_423; \
50879})
52196__ai uint32x4_t vpmaxq_u32(uint32x4_t __p0, uint32x4_t __p1) {
52197 uint32x4_t __ret;
52198 __ret = (uint32x4_t) __builtin_neon_vpmaxq_v((int8x16_t)__p0, (int8x16_t)__p1, 50);
52199 return __ret;
52200}
5088052201#else
50881#define vcopy_laneq_p16(__p0_424, __p1_424, __p2_424, __p3_424) __extension__ ({ \
50882 poly16x4_t __ret_424; \
50883 poly16x4_t __s0_424 = __p0_424; \
50884 poly16x8_t __s2_424 = __p2_424; \
50885 poly16x4_t __rev0_424; __rev0_424 = __builtin_shufflevector(__s0_424, __s0_424, 3, 2, 1, 0); \
50886 poly16x8_t __rev2_424; __rev2_424 = __builtin_shufflevector(__s2_424, __s2_424, 7, 6, 5, 4, 3, 2, 1, 0); \
50887 __ret_424 = __noswap_vset_lane_p16(__noswap_vgetq_lane_p16(__rev2_424, __p3_424), __rev0_424, __p1_424); \
50888 __ret_424 = __builtin_shufflevector(__ret_424, __ret_424, 3, 2, 1, 0); \
50889 __ret_424; \
50890})
52202__ai uint32x4_t vpmaxq_u32(uint32x4_t __p0, uint32x4_t __p1) {
52203 uint32x4_t __ret;
52204 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
52205 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
52206 __ret = (uint32x4_t) __builtin_neon_vpmaxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 50);
52207 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
52208 return __ret;
52209}
5089152210#endif
5089252211
5089352212#ifdef __LITTLE_ENDIAN__
50894#define vcopy_laneq_u8(__p0_425, __p1_425, __p2_425, __p3_425) __extension__ ({ \
50895 uint8x8_t __ret_425; \
50896 uint8x8_t __s0_425 = __p0_425; \
50897 uint8x16_t __s2_425 = __p2_425; \
50898 __ret_425 = vset_lane_u8(vgetq_lane_u8(__s2_425, __p3_425), __s0_425, __p1_425); \
50899 __ret_425; \
50900})
52213__ai uint16x8_t vpmaxq_u16(uint16x8_t __p0, uint16x8_t __p1) {
52214 uint16x8_t __ret;
52215 __ret = (uint16x8_t) __builtin_neon_vpmaxq_v((int8x16_t)__p0, (int8x16_t)__p1, 49);
52216 return __ret;
52217}
5090152218#else
50902#define vcopy_laneq_u8(__p0_426, __p1_426, __p2_426, __p3_426) __extension__ ({ \
50903 uint8x8_t __ret_426; \
50904 uint8x8_t __s0_426 = __p0_426; \
50905 uint8x16_t __s2_426 = __p2_426; \
50906 uint8x8_t __rev0_426; __rev0_426 = __builtin_shufflevector(__s0_426, __s0_426, 7, 6, 5, 4, 3, 2, 1, 0); \
50907 uint8x16_t __rev2_426; __rev2_426 = __builtin_shufflevector(__s2_426, __s2_426, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
50908 __ret_426 = __noswap_vset_lane_u8(__noswap_vgetq_lane_u8(__rev2_426, __p3_426), __rev0_426, __p1_426); \
50909 __ret_426 = __builtin_shufflevector(__ret_426, __ret_426, 7, 6, 5, 4, 3, 2, 1, 0); \
50910 __ret_426; \
50911})
52219__ai uint16x8_t vpmaxq_u16(uint16x8_t __p0, uint16x8_t __p1) {
52220 uint16x8_t __ret;
52221 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
52222 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
52223 __ret = (uint16x8_t) __builtin_neon_vpmaxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 49);
52224 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
52225 return __ret;
52226}
5091252227#endif
5091352228
5091452229#ifdef __LITTLE_ENDIAN__
50915#define vcopy_laneq_u32(__p0_427, __p1_427, __p2_427, __p3_427) __extension__ ({ \
50916 uint32x2_t __ret_427; \
50917 uint32x2_t __s0_427 = __p0_427; \
50918 uint32x4_t __s2_427 = __p2_427; \
50919 __ret_427 = vset_lane_u32(vgetq_lane_u32(__s2_427, __p3_427), __s0_427, __p1_427); \
50920 __ret_427; \
50921})
52230__ai int8x16_t vpmaxq_s8(int8x16_t __p0, int8x16_t __p1) {
52231 int8x16_t __ret;
52232 __ret = (int8x16_t) __builtin_neon_vpmaxq_v((int8x16_t)__p0, (int8x16_t)__p1, 32);
52233 return __ret;
52234}
5092252235#else
50923#define vcopy_laneq_u32(__p0_428, __p1_428, __p2_428, __p3_428) __extension__ ({ \
50924 uint32x2_t __ret_428; \
50925 uint32x2_t __s0_428 = __p0_428; \
50926 uint32x4_t __s2_428 = __p2_428; \
50927 uint32x2_t __rev0_428; __rev0_428 = __builtin_shufflevector(__s0_428, __s0_428, 1, 0); \
50928 uint32x4_t __rev2_428; __rev2_428 = __builtin_shufflevector(__s2_428, __s2_428, 3, 2, 1, 0); \
50929 __ret_428 = __noswap_vset_lane_u32(__noswap_vgetq_lane_u32(__rev2_428, __p3_428), __rev0_428, __p1_428); \
50930 __ret_428 = __builtin_shufflevector(__ret_428, __ret_428, 1, 0); \
50931 __ret_428; \
50932})
52236__ai int8x16_t vpmaxq_s8(int8x16_t __p0, int8x16_t __p1) {
52237 int8x16_t __ret;
52238 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
52239 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
52240 __ret = (int8x16_t) __builtin_neon_vpmaxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 32);
52241 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
52242 return __ret;
52243}
5093352244#endif
5093452245
5093552246#ifdef __LITTLE_ENDIAN__
50936#define vcopy_laneq_u64(__p0_429, __p1_429, __p2_429, __p3_429) __extension__ ({ \
50937 uint64x1_t __ret_429; \
50938 uint64x1_t __s0_429 = __p0_429; \
50939 uint64x2_t __s2_429 = __p2_429; \
50940 __ret_429 = vset_lane_u64(vgetq_lane_u64(__s2_429, __p3_429), __s0_429, __p1_429); \
50941 __ret_429; \
50942})
52247__ai float64x2_t vpmaxq_f64(float64x2_t __p0, float64x2_t __p1) {
52248 float64x2_t __ret;
52249 __ret = (float64x2_t) __builtin_neon_vpmaxq_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
52250 return __ret;
52251}
5094352252#else
50944#define vcopy_laneq_u64(__p0_430, __p1_430, __p2_430, __p3_430) __extension__ ({ \
50945 uint64x1_t __ret_430; \
50946 uint64x1_t __s0_430 = __p0_430; \
50947 uint64x2_t __s2_430 = __p2_430; \
50948 uint64x2_t __rev2_430; __rev2_430 = __builtin_shufflevector(__s2_430, __s2_430, 1, 0); \
50949 __ret_430 = vset_lane_u64(__noswap_vgetq_lane_u64(__rev2_430, __p3_430), __s0_430, __p1_430); \
50950 __ret_430; \
50951})
52253__ai float64x2_t vpmaxq_f64(float64x2_t __p0, float64x2_t __p1) {
52254 float64x2_t __ret;
52255 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
52256 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
52257 __ret = (float64x2_t) __builtin_neon_vpmaxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
52258 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
52259 return __ret;
52260}
5095252261#endif
5095352262
5095452263#ifdef __LITTLE_ENDIAN__
50955#define vcopy_laneq_u16(__p0_431, __p1_431, __p2_431, __p3_431) __extension__ ({ \
50956 uint16x4_t __ret_431; \
50957 uint16x4_t __s0_431 = __p0_431; \
50958 uint16x8_t __s2_431 = __p2_431; \
50959 __ret_431 = vset_lane_u16(vgetq_lane_u16(__s2_431, __p3_431), __s0_431, __p1_431); \
50960 __ret_431; \
50961})
52264__ai float32x4_t vpmaxq_f32(float32x4_t __p0, float32x4_t __p1) {
52265 float32x4_t __ret;
52266 __ret = (float32x4_t) __builtin_neon_vpmaxq_v((int8x16_t)__p0, (int8x16_t)__p1, 41);
52267 return __ret;
52268}
5096252269#else
50963#define vcopy_laneq_u16(__p0_432, __p1_432, __p2_432, __p3_432) __extension__ ({ \
50964 uint16x4_t __ret_432; \
50965 uint16x4_t __s0_432 = __p0_432; \
50966 uint16x8_t __s2_432 = __p2_432; \
50967 uint16x4_t __rev0_432; __rev0_432 = __builtin_shufflevector(__s0_432, __s0_432, 3, 2, 1, 0); \
50968 uint16x8_t __rev2_432; __rev2_432 = __builtin_shufflevector(__s2_432, __s2_432, 7, 6, 5, 4, 3, 2, 1, 0); \
50969 __ret_432 = __noswap_vset_lane_u16(__noswap_vgetq_lane_u16(__rev2_432, __p3_432), __rev0_432, __p1_432); \
50970 __ret_432 = __builtin_shufflevector(__ret_432, __ret_432, 3, 2, 1, 0); \
50971 __ret_432; \
50972})
52270__ai float32x4_t vpmaxq_f32(float32x4_t __p0, float32x4_t __p1) {
52271 float32x4_t __ret;
52272 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
52273 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
52274 __ret = (float32x4_t) __builtin_neon_vpmaxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 41);
52275 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
52276 return __ret;
52277}
5097352278#endif
5097452279
5097552280#ifdef __LITTLE_ENDIAN__
50976#define vcopy_laneq_s8(__p0_433, __p1_433, __p2_433, __p3_433) __extension__ ({ \
50977 int8x8_t __ret_433; \
50978 int8x8_t __s0_433 = __p0_433; \
50979 int8x16_t __s2_433 = __p2_433; \
50980 __ret_433 = vset_lane_s8(vgetq_lane_s8(__s2_433, __p3_433), __s0_433, __p1_433); \
50981 __ret_433; \
50982})
52281__ai int32x4_t vpmaxq_s32(int32x4_t __p0, int32x4_t __p1) {
52282 int32x4_t __ret;
52283 __ret = (int32x4_t) __builtin_neon_vpmaxq_v((int8x16_t)__p0, (int8x16_t)__p1, 34);
52284 return __ret;
52285}
5098352286#else
50984#define vcopy_laneq_s8(__p0_434, __p1_434, __p2_434, __p3_434) __extension__ ({ \
50985 int8x8_t __ret_434; \
50986 int8x8_t __s0_434 = __p0_434; \
50987 int8x16_t __s2_434 = __p2_434; \
50988 int8x8_t __rev0_434; __rev0_434 = __builtin_shufflevector(__s0_434, __s0_434, 7, 6, 5, 4, 3, 2, 1, 0); \
50989 int8x16_t __rev2_434; __rev2_434 = __builtin_shufflevector(__s2_434, __s2_434, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
50990 __ret_434 = __noswap_vset_lane_s8(__noswap_vgetq_lane_s8(__rev2_434, __p3_434), __rev0_434, __p1_434); \
50991 __ret_434 = __builtin_shufflevector(__ret_434, __ret_434, 7, 6, 5, 4, 3, 2, 1, 0); \
50992 __ret_434; \
50993})
52287__ai int32x4_t vpmaxq_s32(int32x4_t __p0, int32x4_t __p1) {
52288 int32x4_t __ret;
52289 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
52290 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
52291 __ret = (int32x4_t) __builtin_neon_vpmaxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 34);
52292 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
52293 return __ret;
52294}
5099452295#endif
5099552296
5099652297#ifdef __LITTLE_ENDIAN__
50997#define vcopy_laneq_f32(__p0_435, __p1_435, __p2_435, __p3_435) __extension__ ({ \
50998 float32x2_t __ret_435; \
50999 float32x2_t __s0_435 = __p0_435; \
51000 float32x4_t __s2_435 = __p2_435; \
51001 __ret_435 = vset_lane_f32(vgetq_lane_f32(__s2_435, __p3_435), __s0_435, __p1_435); \
51002 __ret_435; \
51003})
52298__ai int16x8_t vpmaxq_s16(int16x8_t __p0, int16x8_t __p1) {
52299 int16x8_t __ret;
52300 __ret = (int16x8_t) __builtin_neon_vpmaxq_v((int8x16_t)__p0, (int8x16_t)__p1, 33);
52301 return __ret;
52302}
5100452303#else
51005#define vcopy_laneq_f32(__p0_436, __p1_436, __p2_436, __p3_436) __extension__ ({ \
51006 float32x2_t __ret_436; \
51007 float32x2_t __s0_436 = __p0_436; \
51008 float32x4_t __s2_436 = __p2_436; \
51009 float32x2_t __rev0_436; __rev0_436 = __builtin_shufflevector(__s0_436, __s0_436, 1, 0); \
51010 float32x4_t __rev2_436; __rev2_436 = __builtin_shufflevector(__s2_436, __s2_436, 3, 2, 1, 0); \
51011 __ret_436 = __noswap_vset_lane_f32(__noswap_vgetq_lane_f32(__rev2_436, __p3_436), __rev0_436, __p1_436); \
51012 __ret_436 = __builtin_shufflevector(__ret_436, __ret_436, 1, 0); \
51013 __ret_436; \
51014})
52304__ai int16x8_t vpmaxq_s16(int16x8_t __p0, int16x8_t __p1) {
52305 int16x8_t __ret;
52306 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
52307 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
52308 __ret = (int16x8_t) __builtin_neon_vpmaxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 33);
52309 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
52310 return __ret;
52311}
5101552312#endif
5101652313
5101752314#ifdef __LITTLE_ENDIAN__
51018#define vcopy_laneq_s32(__p0_437, __p1_437, __p2_437, __p3_437) __extension__ ({ \
51019 int32x2_t __ret_437; \
51020 int32x2_t __s0_437 = __p0_437; \
51021 int32x4_t __s2_437 = __p2_437; \
51022 __ret_437 = vset_lane_s32(vgetq_lane_s32(__s2_437, __p3_437), __s0_437, __p1_437); \
51023 __ret_437; \
51024})
52315__ai float64_t vpmaxqd_f64(float64x2_t __p0) {
52316 float64_t __ret;
52317 __ret = (float64_t) __builtin_neon_vpmaxqd_f64(__p0);
52318 return __ret;
52319}
5102552320#else
51026#define vcopy_laneq_s32(__p0_438, __p1_438, __p2_438, __p3_438) __extension__ ({ \
51027 int32x2_t __ret_438; \
51028 int32x2_t __s0_438 = __p0_438; \
51029 int32x4_t __s2_438 = __p2_438; \
51030 int32x2_t __rev0_438; __rev0_438 = __builtin_shufflevector(__s0_438, __s0_438, 1, 0); \
51031 int32x4_t __rev2_438; __rev2_438 = __builtin_shufflevector(__s2_438, __s2_438, 3, 2, 1, 0); \
51032 __ret_438 = __noswap_vset_lane_s32(__noswap_vgetq_lane_s32(__rev2_438, __p3_438), __rev0_438, __p1_438); \
51033 __ret_438 = __builtin_shufflevector(__ret_438, __ret_438, 1, 0); \
51034 __ret_438; \
51035})
52321__ai float64_t vpmaxqd_f64(float64x2_t __p0) {
52322 float64_t __ret;
52323 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
52324 __ret = (float64_t) __builtin_neon_vpmaxqd_f64(__rev0);
52325 return __ret;
52326}
5103652327#endif
5103752328
5103852329#ifdef __LITTLE_ENDIAN__
51039#define vcopy_laneq_s64(__p0_439, __p1_439, __p2_439, __p3_439) __extension__ ({ \
51040 int64x1_t __ret_439; \
51041 int64x1_t __s0_439 = __p0_439; \
51042 int64x2_t __s2_439 = __p2_439; \
51043 __ret_439 = vset_lane_s64(vgetq_lane_s64(__s2_439, __p3_439), __s0_439, __p1_439); \
51044 __ret_439; \
51045})
52330__ai float32_t vpmaxs_f32(float32x2_t __p0) {
52331 float32_t __ret;
52332 __ret = (float32_t) __builtin_neon_vpmaxs_f32(__p0);
52333 return __ret;
52334}
5104652335#else
51047#define vcopy_laneq_s64(__p0_440, __p1_440, __p2_440, __p3_440) __extension__ ({ \
51048 int64x1_t __ret_440; \
51049 int64x1_t __s0_440 = __p0_440; \
51050 int64x2_t __s2_440 = __p2_440; \
51051 int64x2_t __rev2_440; __rev2_440 = __builtin_shufflevector(__s2_440, __s2_440, 1, 0); \
51052 __ret_440 = vset_lane_s64(__noswap_vgetq_lane_s64(__rev2_440, __p3_440), __s0_440, __p1_440); \
51053 __ret_440; \
51054})
52336__ai float32_t vpmaxs_f32(float32x2_t __p0) {
52337 float32_t __ret;
52338 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
52339 __ret = (float32_t) __builtin_neon_vpmaxs_f32(__rev0);
52340 return __ret;
52341}
5105552342#endif
5105652343
5105752344#ifdef __LITTLE_ENDIAN__
51058#define vcopy_laneq_s16(__p0_441, __p1_441, __p2_441, __p3_441) __extension__ ({ \
51059 int16x4_t __ret_441; \
51060 int16x4_t __s0_441 = __p0_441; \
51061 int16x8_t __s2_441 = __p2_441; \
51062 __ret_441 = vset_lane_s16(vgetq_lane_s16(__s2_441, __p3_441), __s0_441, __p1_441); \
51063 __ret_441; \
51064})
52345__ai float64x2_t vpmaxnmq_f64(float64x2_t __p0, float64x2_t __p1) {
52346 float64x2_t __ret;
52347 __ret = (float64x2_t) __builtin_neon_vpmaxnmq_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
52348 return __ret;
52349}
5106552350#else
51066#define vcopy_laneq_s16(__p0_442, __p1_442, __p2_442, __p3_442) __extension__ ({ \
51067 int16x4_t __ret_442; \
51068 int16x4_t __s0_442 = __p0_442; \
51069 int16x8_t __s2_442 = __p2_442; \
51070 int16x4_t __rev0_442; __rev0_442 = __builtin_shufflevector(__s0_442, __s0_442, 3, 2, 1, 0); \
51071 int16x8_t __rev2_442; __rev2_442 = __builtin_shufflevector(__s2_442, __s2_442, 7, 6, 5, 4, 3, 2, 1, 0); \
51072 __ret_442 = __noswap_vset_lane_s16(__noswap_vgetq_lane_s16(__rev2_442, __p3_442), __rev0_442, __p1_442); \
51073 __ret_442 = __builtin_shufflevector(__ret_442, __ret_442, 3, 2, 1, 0); \
51074 __ret_442; \
51075})
52351__ai float64x2_t vpmaxnmq_f64(float64x2_t __p0, float64x2_t __p1) {
52352 float64x2_t __ret;
52353 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
52354 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
52355 __ret = (float64x2_t) __builtin_neon_vpmaxnmq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
52356 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
52357 return __ret;
52358}
5107652359#endif
5107752360
51078#define vcreate_p64(__p0) __extension__ ({ \
51079 poly64x1_t __ret; \
51080 uint64_t __promote = __p0; \
51081 __ret = (poly64x1_t)(__promote); \
51082 __ret; \
51083})
51084#define vcreate_f64(__p0) __extension__ ({ \
51085 float64x1_t __ret; \
51086 uint64_t __promote = __p0; \
51087 __ret = (float64x1_t)(__promote); \
51088 __ret; \
51089})
51090__ai float32_t vcvts_f32_s32(int32_t __p0) {
51091 float32_t __ret;
51092 __ret = (float32_t) __builtin_neon_vcvts_f32_s32(__p0);
52361#ifdef __LITTLE_ENDIAN__
52362__ai float32x4_t vpmaxnmq_f32(float32x4_t __p0, float32x4_t __p1) {
52363 float32x4_t __ret;
52364 __ret = (float32x4_t) __builtin_neon_vpmaxnmq_v((int8x16_t)__p0, (int8x16_t)__p1, 41);
5109352365 return __ret;
5109452366}
51095__ai float32_t vcvts_f32_u32(uint32_t __p0) {
51096 float32_t __ret;
51097 __ret = (float32_t) __builtin_neon_vcvts_f32_u32(__p0);
52367#else
52368__ai float32x4_t vpmaxnmq_f32(float32x4_t __p0, float32x4_t __p1) {
52369 float32x4_t __ret;
52370 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
52371 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
52372 __ret = (float32x4_t) __builtin_neon_vpmaxnmq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 41);
52373 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
5109852374 return __ret;
5109952375}
52376#endif
52377
5110052378#ifdef __LITTLE_ENDIAN__
51101__ai float32x2_t vcvt_f32_f64(float64x2_t __p0) {
52379__ai float32x2_t vpmaxnm_f32(float32x2_t __p0, float32x2_t __p1) {
5110252380 float32x2_t __ret;
51103 __ret = (float32x2_t) __builtin_neon_vcvt_f32_f64((int8x16_t)__p0, 9);
52381 __ret = (float32x2_t) __builtin_neon_vpmaxnm_v((int8x8_t)__p0, (int8x8_t)__p1, 9);
5110452382 return __ret;
5110552383}
5110652384#else
51107__ai float32x2_t vcvt_f32_f64(float64x2_t __p0) {
52385__ai float32x2_t vpmaxnm_f32(float32x2_t __p0, float32x2_t __p1) {
5110852386 float32x2_t __ret;
51109 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
51110 __ret = (float32x2_t) __builtin_neon_vcvt_f32_f64((int8x16_t)__rev0, 9);
52387 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
52388 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
52389 __ret = (float32x2_t) __builtin_neon_vpmaxnm_v((int8x8_t)__rev0, (int8x8_t)__rev1, 9);
5111152390 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
5111252391 return __ret;
5111352392}
51114__ai float32x2_t __noswap_vcvt_f32_f64(float64x2_t __p0) {
51115 float32x2_t __ret;
51116 __ret = (float32x2_t) __builtin_neon_vcvt_f32_f64((int8x16_t)__p0, 9);
51117 return __ret;
51118}
5111952393#endif
5112052394
51121__ai float64_t vcvtd_f64_s64(int64_t __p0) {
52395#ifdef __LITTLE_ENDIAN__
52396__ai float64_t vpmaxnmqd_f64(float64x2_t __p0) {
5112252397 float64_t __ret;
51123 __ret = (float64_t) __builtin_neon_vcvtd_f64_s64(__p0);
52398 __ret = (float64_t) __builtin_neon_vpmaxnmqd_f64(__p0);
5112452399 return __ret;
5112552400}
51126__ai float64_t vcvtd_f64_u64(uint64_t __p0) {
52401#else
52402__ai float64_t vpmaxnmqd_f64(float64x2_t __p0) {
5112752403 float64_t __ret;
51128 __ret = (float64_t) __builtin_neon_vcvtd_f64_u64(__p0);
52404 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
52405 __ret = (float64_t) __builtin_neon_vpmaxnmqd_f64(__rev0);
5112952406 return __ret;
5113052407}
52408#endif
52409
5113152410#ifdef __LITTLE_ENDIAN__
51132__ai float64x2_t vcvtq_f64_u64(uint64x2_t __p0) {
51133 float64x2_t __ret;
51134 __ret = (float64x2_t) __builtin_neon_vcvtq_f64_v((int8x16_t)__p0, 51);
52411__ai float32_t vpmaxnms_f32(float32x2_t __p0) {
52412 float32_t __ret;
52413 __ret = (float32_t) __builtin_neon_vpmaxnms_f32(__p0);
5113552414 return __ret;
5113652415}
5113752416#else
51138__ai float64x2_t vcvtq_f64_u64(uint64x2_t __p0) {
51139 float64x2_t __ret;
51140 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
51141 __ret = (float64x2_t) __builtin_neon_vcvtq_f64_v((int8x16_t)__rev0, 51);
51142 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
52417__ai float32_t vpmaxnms_f32(float32x2_t __p0) {
52418 float32_t __ret;
52419 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
52420 __ret = (float32_t) __builtin_neon_vpmaxnms_f32(__rev0);
5114352421 return __ret;
5114452422}
5114552423#endif
5114652424
5114752425#ifdef __LITTLE_ENDIAN__
51148__ai float64x2_t vcvtq_f64_s64(int64x2_t __p0) {
51149 float64x2_t __ret;
51150 __ret = (float64x2_t) __builtin_neon_vcvtq_f64_v((int8x16_t)__p0, 35);
52426__ai uint8x16_t vpminq_u8(uint8x16_t __p0, uint8x16_t __p1) {
52427 uint8x16_t __ret;
52428 __ret = (uint8x16_t) __builtin_neon_vpminq_v((int8x16_t)__p0, (int8x16_t)__p1, 48);
5115152429 return __ret;
5115252430}
5115352431#else
51154__ai float64x2_t vcvtq_f64_s64(int64x2_t __p0) {
51155 float64x2_t __ret;
51156 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
51157 __ret = (float64x2_t) __builtin_neon_vcvtq_f64_v((int8x16_t)__rev0, 35);
51158 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
52432__ai uint8x16_t vpminq_u8(uint8x16_t __p0, uint8x16_t __p1) {
52433 uint8x16_t __ret;
52434 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
52435 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
52436 __ret = (uint8x16_t) __builtin_neon_vpminq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 48);
52437 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
5115952438 return __ret;
5116052439}
5116152440#endif
5116252441
51163__ai float64x1_t vcvt_f64_u64(uint64x1_t __p0) {
51164 float64x1_t __ret;
51165 __ret = (float64x1_t) __builtin_neon_vcvt_f64_v((int8x8_t)__p0, 19);
52442#ifdef __LITTLE_ENDIAN__
52443__ai uint32x4_t vpminq_u32(uint32x4_t __p0, uint32x4_t __p1) {
52444 uint32x4_t __ret;
52445 __ret = (uint32x4_t) __builtin_neon_vpminq_v((int8x16_t)__p0, (int8x16_t)__p1, 50);
5116652446 return __ret;
5116752447}
51168__ai float64x1_t vcvt_f64_s64(int64x1_t __p0) {
51169 float64x1_t __ret;
51170 __ret = (float64x1_t) __builtin_neon_vcvt_f64_v((int8x8_t)__p0, 3);
52448#else
52449__ai uint32x4_t vpminq_u32(uint32x4_t __p0, uint32x4_t __p1) {
52450 uint32x4_t __ret;
52451 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
52452 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
52453 __ret = (uint32x4_t) __builtin_neon_vpminq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 50);
52454 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
5117152455 return __ret;
5117252456}
52457#endif
52458
5117352459#ifdef __LITTLE_ENDIAN__
51174__ai float64x2_t vcvt_f64_f32(float32x2_t __p0) {
51175 float64x2_t __ret;
51176 __ret = (float64x2_t) __builtin_neon_vcvt_f64_f32((int8x8_t)__p0, 42);
52460__ai uint16x8_t vpminq_u16(uint16x8_t __p0, uint16x8_t __p1) {
52461 uint16x8_t __ret;
52462 __ret = (uint16x8_t) __builtin_neon_vpminq_v((int8x16_t)__p0, (int8x16_t)__p1, 49);
5117752463 return __ret;
5117852464}
5117952465#else
51180__ai float64x2_t vcvt_f64_f32(float32x2_t __p0) {
51181 float64x2_t __ret;
51182 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
51183 __ret = (float64x2_t) __builtin_neon_vcvt_f64_f32((int8x8_t)__rev0, 42);
51184 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
52466__ai uint16x8_t vpminq_u16(uint16x8_t __p0, uint16x8_t __p1) {
52467 uint16x8_t __ret;
52468 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
52469 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
52470 __ret = (uint16x8_t) __builtin_neon_vpminq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 49);
52471 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
5118552472 return __ret;
5118652473}
51187__ai float64x2_t __noswap_vcvt_f64_f32(float32x2_t __p0) {
51188 float64x2_t __ret;
51189 __ret = (float64x2_t) __builtin_neon_vcvt_f64_f32((int8x8_t)__p0, 42);
52474#endif
52475
52476#ifdef __LITTLE_ENDIAN__
52477__ai int8x16_t vpminq_s8(int8x16_t __p0, int8x16_t __p1) {
52478 int8x16_t __ret;
52479 __ret = (int8x16_t) __builtin_neon_vpminq_v((int8x16_t)__p0, (int8x16_t)__p1, 32);
52480 return __ret;
52481}
52482#else
52483__ai int8x16_t vpminq_s8(int8x16_t __p0, int8x16_t __p1) {
52484 int8x16_t __ret;
52485 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
52486 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
52487 __ret = (int8x16_t) __builtin_neon_vpminq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 32);
52488 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
5119052489 return __ret;
5119152490}
5119252491#endif
5119352492
5119452493#ifdef __LITTLE_ENDIAN__
51195__ai float16x8_t vcvt_high_f16_f32(float16x4_t __p0, float32x4_t __p1) {
51196 float16x8_t __ret;
51197 __ret = vcombine_f16(__p0, vcvt_f16_f32(__p1));
52494__ai float64x2_t vpminq_f64(float64x2_t __p0, float64x2_t __p1) {
52495 float64x2_t __ret;
52496 __ret = (float64x2_t) __builtin_neon_vpminq_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
5119852497 return __ret;
5119952498}
5120052499#else
51201__ai float16x8_t vcvt_high_f16_f32(float16x4_t __p0, float32x4_t __p1) {
51202 float16x8_t __ret;
51203 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
51204 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
51205 __ret = __noswap_vcombine_f16(__rev0, __noswap_vcvt_f16_f32(__rev1));
51206 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
52500__ai float64x2_t vpminq_f64(float64x2_t __p0, float64x2_t __p1) {
52501 float64x2_t __ret;
52502 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
52503 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
52504 __ret = (float64x2_t) __builtin_neon_vpminq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
52505 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
5120752506 return __ret;
5120852507}
5120952508#endif
5121052509
5121152510#ifdef __LITTLE_ENDIAN__
51212__ai float32x4_t vcvt_high_f32_f16(float16x8_t __p0) {
52511__ai float32x4_t vpminq_f32(float32x4_t __p0, float32x4_t __p1) {
5121352512 float32x4_t __ret;
51214 __ret = vcvt_f32_f16(vget_high_f16(__p0));
52513 __ret = (float32x4_t) __builtin_neon_vpminq_v((int8x16_t)__p0, (int8x16_t)__p1, 41);
5121552514 return __ret;
5121652515}
5121752516#else
51218__ai float32x4_t vcvt_high_f32_f16(float16x8_t __p0) {
52517__ai float32x4_t vpminq_f32(float32x4_t __p0, float32x4_t __p1) {
5121952518 float32x4_t __ret;
51220 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
51221 __ret = __noswap_vcvt_f32_f16(__noswap_vget_high_f16(__rev0));
52519 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
52520 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
52521 __ret = (float32x4_t) __builtin_neon_vpminq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 41);
5122252522 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
5122352523 return __ret;
5122452524}
5122552525#endif
5122652526
5122752527#ifdef __LITTLE_ENDIAN__
51228__ai float32x4_t vcvt_high_f32_f64(float32x2_t __p0, float64x2_t __p1) {
51229 float32x4_t __ret;
51230 __ret = vcombine_f32(__p0, vcvt_f32_f64(__p1));
52528__ai int32x4_t vpminq_s32(int32x4_t __p0, int32x4_t __p1) {
52529 int32x4_t __ret;
52530 __ret = (int32x4_t) __builtin_neon_vpminq_v((int8x16_t)__p0, (int8x16_t)__p1, 34);
5123152531 return __ret;
5123252532}
5123352533#else
51234__ai float32x4_t vcvt_high_f32_f64(float32x2_t __p0, float64x2_t __p1) {
51235 float32x4_t __ret;
51236 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
51237 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
51238 __ret = __noswap_vcombine_f32(__rev0, __noswap_vcvt_f32_f64(__rev1));
52534__ai int32x4_t vpminq_s32(int32x4_t __p0, int32x4_t __p1) {
52535 int32x4_t __ret;
52536 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
52537 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
52538 __ret = (int32x4_t) __builtin_neon_vpminq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 34);
5123952539 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
5124052540 return __ret;
5124152541}
5124252542#endif
5124352543
5124452544#ifdef __LITTLE_ENDIAN__
51245__ai float64x2_t vcvt_high_f64_f32(float32x4_t __p0) {
51246 float64x2_t __ret;
51247 __ret = vcvt_f64_f32(vget_high_f32(__p0));
52545__ai int16x8_t vpminq_s16(int16x8_t __p0, int16x8_t __p1) {
52546 int16x8_t __ret;
52547 __ret = (int16x8_t) __builtin_neon_vpminq_v((int8x16_t)__p0, (int8x16_t)__p1, 33);
5124852548 return __ret;
5124952549}
5125052550#else
51251__ai float64x2_t vcvt_high_f64_f32(float32x4_t __p0) {
51252 float64x2_t __ret;
51253 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
51254 __ret = __noswap_vcvt_f64_f32(__noswap_vget_high_f32(__rev0));
51255 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
52551__ai int16x8_t vpminq_s16(int16x8_t __p0, int16x8_t __p1) {
52552 int16x8_t __ret;
52553 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
52554 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
52555 __ret = (int16x8_t) __builtin_neon_vpminq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 33);
52556 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
5125652557 return __ret;
5125752558}
5125852559#endif
5125952560
51260#define vcvts_n_f32_u32(__p0, __p1) __extension__ ({ \
51261 float32_t __ret; \
51262 uint32_t __s0 = __p0; \
51263 __ret = (float32_t) __builtin_neon_vcvts_n_f32_u32(__s0, __p1); \
51264 __ret; \
51265})
51266#define vcvts_n_f32_s32(__p0, __p1) __extension__ ({ \
51267 float32_t __ret; \
51268 int32_t __s0 = __p0; \
51269 __ret = (float32_t) __builtin_neon_vcvts_n_f32_s32(__s0, __p1); \
51270 __ret; \
51271})
5127252561#ifdef __LITTLE_ENDIAN__
51273#define vcvtq_n_f64_u64(__p0, __p1) __extension__ ({ \
51274 float64x2_t __ret; \
51275 uint64x2_t __s0 = __p0; \
51276 __ret = (float64x2_t) __builtin_neon_vcvtq_n_f64_v((int8x16_t)__s0, __p1, 51); \
51277 __ret; \
51278})
52562__ai float64_t vpminqd_f64(float64x2_t __p0) {
52563 float64_t __ret;
52564 __ret = (float64_t) __builtin_neon_vpminqd_f64(__p0);
52565 return __ret;
52566}
5127952567#else
51280#define vcvtq_n_f64_u64(__p0, __p1) __extension__ ({ \
51281 float64x2_t __ret; \
51282 uint64x2_t __s0 = __p0; \
51283 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
51284 __ret = (float64x2_t) __builtin_neon_vcvtq_n_f64_v((int8x16_t)__rev0, __p1, 51); \
51285 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
51286 __ret; \
51287})
52568__ai float64_t vpminqd_f64(float64x2_t __p0) {
52569 float64_t __ret;
52570 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
52571 __ret = (float64_t) __builtin_neon_vpminqd_f64(__rev0);
52572 return __ret;
52573}
5128852574#endif
5128952575
5129052576#ifdef __LITTLE_ENDIAN__
51291#define vcvtq_n_f64_s64(__p0, __p1) __extension__ ({ \
51292 float64x2_t __ret; \
51293 int64x2_t __s0 = __p0; \
51294 __ret = (float64x2_t) __builtin_neon_vcvtq_n_f64_v((int8x16_t)__s0, __p1, 35); \
51295 __ret; \
51296})
52577__ai float32_t vpmins_f32(float32x2_t __p0) {
52578 float32_t __ret;
52579 __ret = (float32_t) __builtin_neon_vpmins_f32(__p0);
52580 return __ret;
52581}
5129752582#else
51298#define vcvtq_n_f64_s64(__p0, __p1) __extension__ ({ \
51299 float64x2_t __ret; \
51300 int64x2_t __s0 = __p0; \
51301 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
51302 __ret = (float64x2_t) __builtin_neon_vcvtq_n_f64_v((int8x16_t)__rev0, __p1, 35); \
51303 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
51304 __ret; \
51305})
52583__ai float32_t vpmins_f32(float32x2_t __p0) {
52584 float32_t __ret;
52585 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
52586 __ret = (float32_t) __builtin_neon_vpmins_f32(__rev0);
52587 return __ret;
52588}
5130652589#endif
5130752590
51308#define vcvt_n_f64_u64(__p0, __p1) __extension__ ({ \
51309 float64x1_t __ret; \
51310 uint64x1_t __s0 = __p0; \
51311 __ret = (float64x1_t) __builtin_neon_vcvt_n_f64_v((int8x8_t)__s0, __p1, 19); \
51312 __ret; \
51313})
51314#define vcvt_n_f64_s64(__p0, __p1) __extension__ ({ \
51315 float64x1_t __ret; \
51316 int64x1_t __s0 = __p0; \
51317 __ret = (float64x1_t) __builtin_neon_vcvt_n_f64_v((int8x8_t)__s0, __p1, 3); \
51318 __ret; \
51319})
51320#define vcvtd_n_f64_u64(__p0, __p1) __extension__ ({ \
51321 float64_t __ret; \
51322 uint64_t __s0 = __p0; \
51323 __ret = (float64_t) __builtin_neon_vcvtd_n_f64_u64(__s0, __p1); \
51324 __ret; \
51325})
51326#define vcvtd_n_f64_s64(__p0, __p1) __extension__ ({ \
51327 float64_t __ret; \
51328 int64_t __s0 = __p0; \
51329 __ret = (float64_t) __builtin_neon_vcvtd_n_f64_s64(__s0, __p1); \
51330 __ret; \
51331})
51332#define vcvts_n_s32_f32(__p0, __p1) __extension__ ({ \
51333 int32_t __ret; \
51334 float32_t __s0 = __p0; \
51335 __ret = (int32_t) __builtin_neon_vcvts_n_s32_f32(__s0, __p1); \
51336 __ret; \
51337})
5133852591#ifdef __LITTLE_ENDIAN__
51339#define vcvtq_n_s64_f64(__p0, __p1) __extension__ ({ \
51340 int64x2_t __ret; \
51341 float64x2_t __s0 = __p0; \
51342 __ret = (int64x2_t) __builtin_neon_vcvtq_n_s64_v((int8x16_t)__s0, __p1, 35); \
51343 __ret; \
51344})
52592__ai float64x2_t vpminnmq_f64(float64x2_t __p0, float64x2_t __p1) {
52593 float64x2_t __ret;
52594 __ret = (float64x2_t) __builtin_neon_vpminnmq_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
52595 return __ret;
52596}
5134552597#else
51346#define vcvtq_n_s64_f64(__p0, __p1) __extension__ ({ \
51347 int64x2_t __ret; \
51348 float64x2_t __s0 = __p0; \
51349 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
51350 __ret = (int64x2_t) __builtin_neon_vcvtq_n_s64_v((int8x16_t)__rev0, __p1, 35); \
51351 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
51352 __ret; \
51353})
52598__ai float64x2_t vpminnmq_f64(float64x2_t __p0, float64x2_t __p1) {
52599 float64x2_t __ret;
52600 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
52601 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
52602 __ret = (float64x2_t) __builtin_neon_vpminnmq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
52603 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
52604 return __ret;
52605}
5135452606#endif
5135552607
51356#define vcvt_n_s64_f64(__p0, __p1) __extension__ ({ \
51357 int64x1_t __ret; \
51358 float64x1_t __s0 = __p0; \
51359 __ret = (int64x1_t) __builtin_neon_vcvt_n_s64_v((int8x8_t)__s0, __p1, 3); \
51360 __ret; \
51361})
51362#define vcvtd_n_s64_f64(__p0, __p1) __extension__ ({ \
51363 int64_t __ret; \
51364 float64_t __s0 = __p0; \
51365 __ret = (int64_t) __builtin_neon_vcvtd_n_s64_f64(__s0, __p1); \
51366 __ret; \
51367})
51368#define vcvts_n_u32_f32(__p0, __p1) __extension__ ({ \
51369 uint32_t __ret; \
51370 float32_t __s0 = __p0; \
51371 __ret = (uint32_t) __builtin_neon_vcvts_n_u32_f32(__s0, __p1); \
51372 __ret; \
51373})
5137452608#ifdef __LITTLE_ENDIAN__
51375#define vcvtq_n_u64_f64(__p0, __p1) __extension__ ({ \
51376 uint64x2_t __ret; \
51377 float64x2_t __s0 = __p0; \
51378 __ret = (uint64x2_t) __builtin_neon_vcvtq_n_u64_v((int8x16_t)__s0, __p1, 51); \
51379 __ret; \
51380})
51381#else
51382#define vcvtq_n_u64_f64(__p0, __p1) __extension__ ({ \
51383 uint64x2_t __ret; \
51384 float64x2_t __s0 = __p0; \
51385 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
51386 __ret = (uint64x2_t) __builtin_neon_vcvtq_n_u64_v((int8x16_t)__rev0, __p1, 51); \
51387 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
51388 __ret; \
51389})
51390#endif
51391
51392#define vcvt_n_u64_f64(__p0, __p1) __extension__ ({ \
51393 uint64x1_t __ret; \
51394 float64x1_t __s0 = __p0; \
51395 __ret = (uint64x1_t) __builtin_neon_vcvt_n_u64_v((int8x8_t)__s0, __p1, 19); \
51396 __ret; \
51397})
51398#define vcvtd_n_u64_f64(__p0, __p1) __extension__ ({ \
51399 uint64_t __ret; \
51400 float64_t __s0 = __p0; \
51401 __ret = (uint64_t) __builtin_neon_vcvtd_n_u64_f64(__s0, __p1); \
51402 __ret; \
51403})
51404__ai int32_t vcvts_s32_f32(float32_t __p0) {
51405 int32_t __ret;
51406 __ret = (int32_t) __builtin_neon_vcvts_s32_f32(__p0);
52609__ai float32x4_t vpminnmq_f32(float32x4_t __p0, float32x4_t __p1) {
52610 float32x4_t __ret;
52611 __ret = (float32x4_t) __builtin_neon_vpminnmq_v((int8x16_t)__p0, (int8x16_t)__p1, 41);
5140752612 return __ret;
5140852613}
51409__ai int64_t vcvtd_s64_f64(float64_t __p0) {
51410 int64_t __ret;
51411 __ret = (int64_t) __builtin_neon_vcvtd_s64_f64(__p0);
52614#else
52615__ai float32x4_t vpminnmq_f32(float32x4_t __p0, float32x4_t __p1) {
52616 float32x4_t __ret;
52617 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
52618 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
52619 __ret = (float32x4_t) __builtin_neon_vpminnmq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 41);
52620 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
5141252621 return __ret;
5141352622}
52623#endif
52624
5141452625#ifdef __LITTLE_ENDIAN__
51415__ai int64x2_t vcvtq_s64_f64(float64x2_t __p0) {
51416 int64x2_t __ret;
51417 __ret = (int64x2_t) __builtin_neon_vcvtq_s64_v((int8x16_t)__p0, 35);
52626__ai float32x2_t vpminnm_f32(float32x2_t __p0, float32x2_t __p1) {
52627 float32x2_t __ret;
52628 __ret = (float32x2_t) __builtin_neon_vpminnm_v((int8x8_t)__p0, (int8x8_t)__p1, 9);
5141852629 return __ret;
5141952630}
5142052631#else
51421__ai int64x2_t vcvtq_s64_f64(float64x2_t __p0) {
51422 int64x2_t __ret;
51423 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
51424 __ret = (int64x2_t) __builtin_neon_vcvtq_s64_v((int8x16_t)__rev0, 35);
52632__ai float32x2_t vpminnm_f32(float32x2_t __p0, float32x2_t __p1) {
52633 float32x2_t __ret;
52634 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
52635 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
52636 __ret = (float32x2_t) __builtin_neon_vpminnm_v((int8x8_t)__rev0, (int8x8_t)__rev1, 9);
5142552637 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
5142652638 return __ret;
5142752639}
5142852640#endif
5142952641
51430__ai int64x1_t vcvt_s64_f64(float64x1_t __p0) {
51431 int64x1_t __ret;
51432 __ret = (int64x1_t) __builtin_neon_vcvt_s64_v((int8x8_t)__p0, 3);
51433 return __ret;
51434}
51435__ai uint32_t vcvts_u32_f32(float32_t __p0) {
51436 uint32_t __ret;
51437 __ret = (uint32_t) __builtin_neon_vcvts_u32_f32(__p0);
52642#ifdef __LITTLE_ENDIAN__
52643__ai float64_t vpminnmqd_f64(float64x2_t __p0) {
52644 float64_t __ret;
52645 __ret = (float64_t) __builtin_neon_vpminnmqd_f64(__p0);
5143852646 return __ret;
5143952647}
51440__ai uint64_t vcvtd_u64_f64(float64_t __p0) {
51441 uint64_t __ret;
51442 __ret = (uint64_t) __builtin_neon_vcvtd_u64_f64(__p0);
52648#else
52649__ai float64_t vpminnmqd_f64(float64x2_t __p0) {
52650 float64_t __ret;
52651 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
52652 __ret = (float64_t) __builtin_neon_vpminnmqd_f64(__rev0);
5144352653 return __ret;
5144452654}
52655#endif
52656
5144552657#ifdef __LITTLE_ENDIAN__
51446__ai uint64x2_t vcvtq_u64_f64(float64x2_t __p0) {
51447 uint64x2_t __ret;
51448 __ret = (uint64x2_t) __builtin_neon_vcvtq_u64_v((int8x16_t)__p0, 51);
52658__ai float32_t vpminnms_f32(float32x2_t __p0) {
52659 float32_t __ret;
52660 __ret = (float32_t) __builtin_neon_vpminnms_f32(__p0);
5144952661 return __ret;
5145052662}
5145152663#else
51452__ai uint64x2_t vcvtq_u64_f64(float64x2_t __p0) {
51453 uint64x2_t __ret;
51454 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
51455 __ret = (uint64x2_t) __builtin_neon_vcvtq_u64_v((int8x16_t)__rev0, 51);
51456 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
52664__ai float32_t vpminnms_f32(float32x2_t __p0) {
52665 float32_t __ret;
52666 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
52667 __ret = (float32_t) __builtin_neon_vpminnms_f32(__rev0);
5145752668 return __ret;
5145852669}
5145952670#endif
5146052671
51461__ai uint64x1_t vcvt_u64_f64(float64x1_t __p0) {
51462 uint64x1_t __ret;
51463 __ret = (uint64x1_t) __builtin_neon_vcvt_u64_v((int8x8_t)__p0, 19);
51464 return __ret;
51465}
51466__ai int32_t vcvtas_s32_f32(float32_t __p0) {
51467 int32_t __ret;
51468 __ret = (int32_t) __builtin_neon_vcvtas_s32_f32(__p0);
52672#ifdef __LITTLE_ENDIAN__
52673__ai int64x2_t vqabsq_s64(int64x2_t __p0) {
52674 int64x2_t __ret;
52675 __ret = (int64x2_t) __builtin_neon_vqabsq_v((int8x16_t)__p0, 35);
5146952676 return __ret;
5147052677}
51471__ai int64_t vcvtad_s64_f64(float64_t __p0) {
51472 int64_t __ret;
51473 __ret = (int64_t) __builtin_neon_vcvtad_s64_f64(__p0);
52678#else
52679__ai int64x2_t vqabsq_s64(int64x2_t __p0) {
52680 int64x2_t __ret;
52681 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
52682 __ret = (int64x2_t) __builtin_neon_vqabsq_v((int8x16_t)__rev0, 35);
52683 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
5147452684 return __ret;
5147552685}
51476__ai uint32_t vcvtas_u32_f32(float32_t __p0) {
51477 uint32_t __ret;
51478 __ret = (uint32_t) __builtin_neon_vcvtas_u32_f32(__p0);
52686#endif
52687
52688__ai int64x1_t vqabs_s64(int64x1_t __p0) {
52689 int64x1_t __ret;
52690 __ret = (int64x1_t) __builtin_neon_vqabs_v((int8x8_t)__p0, 3);
5147952691 return __ret;
5148052692}
51481__ai uint64_t vcvtad_u64_f64(float64_t __p0) {
51482 uint64_t __ret;
51483 __ret = (uint64_t) __builtin_neon_vcvtad_u64_f64(__p0);
52693__ai int8_t vqabsb_s8(int8_t __p0) {
52694 int8_t __ret;
52695 __ret = (int8_t) __builtin_neon_vqabsb_s8(__p0);
5148452696 return __ret;
5148552697}
51486__ai int32_t vcvtms_s32_f32(float32_t __p0) {
52698__ai int32_t vqabss_s32(int32_t __p0) {
5148752699 int32_t __ret;
51488 __ret = (int32_t) __builtin_neon_vcvtms_s32_f32(__p0);
52700 __ret = (int32_t) __builtin_neon_vqabss_s32(__p0);
5148952701 return __ret;
5149052702}
51491__ai int64_t vcvtmd_s64_f64(float64_t __p0) {
52703__ai int64_t vqabsd_s64(int64_t __p0) {
5149252704 int64_t __ret;
51493 __ret = (int64_t) __builtin_neon_vcvtmd_s64_f64(__p0);
52705 __ret = (int64_t) __builtin_neon_vqabsd_s64(__p0);
5149452706 return __ret;
5149552707}
51496__ai uint32_t vcvtms_u32_f32(float32_t __p0) {
51497 uint32_t __ret;
51498 __ret = (uint32_t) __builtin_neon_vcvtms_u32_f32(__p0);
52708__ai int16_t vqabsh_s16(int16_t __p0) {
52709 int16_t __ret;
52710 __ret = (int16_t) __builtin_neon_vqabsh_s16(__p0);
5149952711 return __ret;
5150052712}
51501__ai uint64_t vcvtmd_u64_f64(float64_t __p0) {
51502 uint64_t __ret;
51503 __ret = (uint64_t) __builtin_neon_vcvtmd_u64_f64(__p0);
52713__ai uint8_t vqaddb_u8(uint8_t __p0, uint8_t __p1) {
52714 uint8_t __ret;
52715 __ret = (uint8_t) __builtin_neon_vqaddb_u8(__p0, __p1);
5150452716 return __ret;
5150552717}
51506__ai int32_t vcvtns_s32_f32(float32_t __p0) {
51507 int32_t __ret;
51508 __ret = (int32_t) __builtin_neon_vcvtns_s32_f32(__p0);
52718__ai uint32_t vqadds_u32(uint32_t __p0, uint32_t __p1) {
52719 uint32_t __ret;
52720 __ret = (uint32_t) __builtin_neon_vqadds_u32(__p0, __p1);
5150952721 return __ret;
5151052722}
51511__ai int64_t vcvtnd_s64_f64(float64_t __p0) {
51512 int64_t __ret;
51513 __ret = (int64_t) __builtin_neon_vcvtnd_s64_f64(__p0);
52723__ai uint64_t vqaddd_u64(uint64_t __p0, uint64_t __p1) {
52724 uint64_t __ret;
52725 __ret = (uint64_t) __builtin_neon_vqaddd_u64(__p0, __p1);
5151452726 return __ret;
5151552727}
51516__ai uint32_t vcvtns_u32_f32(float32_t __p0) {
51517 uint32_t __ret;
51518 __ret = (uint32_t) __builtin_neon_vcvtns_u32_f32(__p0);
52728__ai uint16_t vqaddh_u16(uint16_t __p0, uint16_t __p1) {
52729 uint16_t __ret;
52730 __ret = (uint16_t) __builtin_neon_vqaddh_u16(__p0, __p1);
5151952731 return __ret;
5152052732}
51521__ai uint64_t vcvtnd_u64_f64(float64_t __p0) {
51522 uint64_t __ret;
51523 __ret = (uint64_t) __builtin_neon_vcvtnd_u64_f64(__p0);
52733__ai int8_t vqaddb_s8(int8_t __p0, int8_t __p1) {
52734 int8_t __ret;
52735 __ret = (int8_t) __builtin_neon_vqaddb_s8(__p0, __p1);
5152452736 return __ret;
5152552737}
51526__ai int32_t vcvtps_s32_f32(float32_t __p0) {
52738__ai int32_t vqadds_s32(int32_t __p0, int32_t __p1) {
5152752739 int32_t __ret;
51528 __ret = (int32_t) __builtin_neon_vcvtps_s32_f32(__p0);
52740 __ret = (int32_t) __builtin_neon_vqadds_s32(__p0, __p1);
5152952741 return __ret;
5153052742}
51531__ai int64_t vcvtpd_s64_f64(float64_t __p0) {
52743__ai int64_t vqaddd_s64(int64_t __p0, int64_t __p1) {
5153252744 int64_t __ret;
51533 __ret = (int64_t) __builtin_neon_vcvtpd_s64_f64(__p0);
52745 __ret = (int64_t) __builtin_neon_vqaddd_s64(__p0, __p1);
5153452746 return __ret;
5153552747}
51536__ai uint32_t vcvtps_u32_f32(float32_t __p0) {
51537 uint32_t __ret;
51538 __ret = (uint32_t) __builtin_neon_vcvtps_u32_f32(__p0);
52748__ai int16_t vqaddh_s16(int16_t __p0, int16_t __p1) {
52749 int16_t __ret;
52750 __ret = (int16_t) __builtin_neon_vqaddh_s16(__p0, __p1);
5153952751 return __ret;
5154052752}
51541__ai uint64_t vcvtpd_u64_f64(float64_t __p0) {
51542 uint64_t __ret;
51543 __ret = (uint64_t) __builtin_neon_vcvtpd_u64_f64(__p0);
52753__ai int64_t vqdmlals_s32(int64_t __p0, int32_t __p1, int32_t __p2) {
52754 int64_t __ret;
52755 __ret = (int64_t) __builtin_neon_vqdmlals_s32(__p0, __p1, __p2);
5154452756 return __ret;
5154552757}
51546__ai float32_t vcvtxd_f32_f64(float64_t __p0) {
51547 float32_t __ret;
51548 __ret = (float32_t) __builtin_neon_vcvtxd_f32_f64(__p0);
52758__ai int32_t vqdmlalh_s16(int32_t __p0, int16_t __p1, int16_t __p2) {
52759 int32_t __ret;
52760 __ret = (int32_t) __builtin_neon_vqdmlalh_s16(__p0, __p1, __p2);
5154952761 return __ret;
5155052762}
5155152763#ifdef __LITTLE_ENDIAN__
51552__ai float32x2_t vcvtx_f32_f64(float64x2_t __p0) {
51553 float32x2_t __ret;
51554 __ret = (float32x2_t) __builtin_neon_vcvtx_f32_v((int8x16_t)__p0, 42);
52764__ai int64x2_t vqdmlal_high_s32(int64x2_t __p0, int32x4_t __p1, int32x4_t __p2) {
52765 int64x2_t __ret;
52766 __ret = vqdmlal_s32(__p0, vget_high_s32(__p1), vget_high_s32(__p2));
5155552767 return __ret;
5155652768}
5155752769#else
51558__ai float32x2_t vcvtx_f32_f64(float64x2_t __p0) {
51559 float32x2_t __ret;
51560 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
51561 __ret = (float32x2_t) __builtin_neon_vcvtx_f32_v((int8x16_t)__rev0, 42);
52770__ai int64x2_t vqdmlal_high_s32(int64x2_t __p0, int32x4_t __p1, int32x4_t __p2) {
52771 int64x2_t __ret;
52772 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
52773 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
52774 int32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
52775 __ret = __noswap_vqdmlal_s32(__rev0, __noswap_vget_high_s32(__rev1), __noswap_vget_high_s32(__rev2));
5156252776 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
5156352777 return __ret;
5156452778}
51565__ai float32x2_t __noswap_vcvtx_f32_f64(float64x2_t __p0) {
51566 float32x2_t __ret;
51567 __ret = (float32x2_t) __builtin_neon_vcvtx_f32_v((int8x16_t)__p0, 42);
51568 return __ret;
51569}
5157052779#endif
5157152780
5157252781#ifdef __LITTLE_ENDIAN__
51573__ai float32x4_t vcvtx_high_f32_f64(float32x2_t __p0, float64x2_t __p1) {
51574 float32x4_t __ret;
51575 __ret = vcombine_f32(__p0, vcvtx_f32_f64(__p1));
52782__ai int32x4_t vqdmlal_high_s16(int32x4_t __p0, int16x8_t __p1, int16x8_t __p2) {
52783 int32x4_t __ret;
52784 __ret = vqdmlal_s16(__p0, vget_high_s16(__p1), vget_high_s16(__p2));
5157652785 return __ret;
5157752786}
5157852787#else
51579__ai float32x4_t vcvtx_high_f32_f64(float32x2_t __p0, float64x2_t __p1) {
51580 float32x4_t __ret;
51581 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
51582 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
51583 __ret = __noswap_vcombine_f32(__rev0, __noswap_vcvtx_f32_f64(__rev1));
52788__ai int32x4_t vqdmlal_high_s16(int32x4_t __p0, int16x8_t __p1, int16x8_t __p2) {
52789 int32x4_t __ret;
52790 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
52791 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
52792 int16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
52793 __ret = __noswap_vqdmlal_s16(__rev0, __noswap_vget_high_s16(__rev1), __noswap_vget_high_s16(__rev2));
5158452794 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
5158552795 return __ret;
5158652796}
5158752797#endif
5158852798
5158952799#ifdef __LITTLE_ENDIAN__
51590__ai float64x2_t vdivq_f64(float64x2_t __p0, float64x2_t __p1) {
51591 float64x2_t __ret;
51592 __ret = __p0 / __p1;
51593 return __ret;
51594}
52800#define vqdmlal_high_lane_s32(__p0_607, __p1_607, __p2_607, __p3_607) __extension__ ({ \
52801 int64x2_t __ret_607; \
52802 int64x2_t __s0_607 = __p0_607; \
52803 int32x4_t __s1_607 = __p1_607; \
52804 int32x2_t __s2_607 = __p2_607; \
52805 __ret_607 = vqdmlal_s32(__s0_607, vget_high_s32(__s1_607), splat_lane_s32(__s2_607, __p3_607)); \
52806 __ret_607; \
52807})
5159552808#else
51596__ai float64x2_t vdivq_f64(float64x2_t __p0, float64x2_t __p1) {
51597 float64x2_t __ret;
51598 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
51599 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
51600 __ret = __rev0 / __rev1;
51601 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
51602 return __ret;
51603}
52809#define vqdmlal_high_lane_s32(__p0_608, __p1_608, __p2_608, __p3_608) __extension__ ({ \
52810 int64x2_t __ret_608; \
52811 int64x2_t __s0_608 = __p0_608; \
52812 int32x4_t __s1_608 = __p1_608; \
52813 int32x2_t __s2_608 = __p2_608; \
52814 int64x2_t __rev0_608; __rev0_608 = __builtin_shufflevector(__s0_608, __s0_608, 1, 0); \
52815 int32x4_t __rev1_608; __rev1_608 = __builtin_shufflevector(__s1_608, __s1_608, 3, 2, 1, 0); \
52816 int32x2_t __rev2_608; __rev2_608 = __builtin_shufflevector(__s2_608, __s2_608, 1, 0); \
52817 __ret_608 = __noswap_vqdmlal_s32(__rev0_608, __noswap_vget_high_s32(__rev1_608), __noswap_splat_lane_s32(__rev2_608, __p3_608)); \
52818 __ret_608 = __builtin_shufflevector(__ret_608, __ret_608, 1, 0); \
52819 __ret_608; \
52820})
5160452821#endif
5160552822
5160652823#ifdef __LITTLE_ENDIAN__
51607__ai float32x4_t vdivq_f32(float32x4_t __p0, float32x4_t __p1) {
51608 float32x4_t __ret;
51609 __ret = __p0 / __p1;
52824#define vqdmlal_high_lane_s16(__p0_609, __p1_609, __p2_609, __p3_609) __extension__ ({ \
52825 int32x4_t __ret_609; \
52826 int32x4_t __s0_609 = __p0_609; \
52827 int16x8_t __s1_609 = __p1_609; \
52828 int16x4_t __s2_609 = __p2_609; \
52829 __ret_609 = vqdmlal_s16(__s0_609, vget_high_s16(__s1_609), splat_lane_s16(__s2_609, __p3_609)); \
52830 __ret_609; \
52831})
52832#else
52833#define vqdmlal_high_lane_s16(__p0_610, __p1_610, __p2_610, __p3_610) __extension__ ({ \
52834 int32x4_t __ret_610; \
52835 int32x4_t __s0_610 = __p0_610; \
52836 int16x8_t __s1_610 = __p1_610; \
52837 int16x4_t __s2_610 = __p2_610; \
52838 int32x4_t __rev0_610; __rev0_610 = __builtin_shufflevector(__s0_610, __s0_610, 3, 2, 1, 0); \
52839 int16x8_t __rev1_610; __rev1_610 = __builtin_shufflevector(__s1_610, __s1_610, 7, 6, 5, 4, 3, 2, 1, 0); \
52840 int16x4_t __rev2_610; __rev2_610 = __builtin_shufflevector(__s2_610, __s2_610, 3, 2, 1, 0); \
52841 __ret_610 = __noswap_vqdmlal_s16(__rev0_610, __noswap_vget_high_s16(__rev1_610), __noswap_splat_lane_s16(__rev2_610, __p3_610)); \
52842 __ret_610 = __builtin_shufflevector(__ret_610, __ret_610, 3, 2, 1, 0); \
52843 __ret_610; \
52844})
52845#endif
52846
52847#ifdef __LITTLE_ENDIAN__
52848#define vqdmlal_high_laneq_s32(__p0_611, __p1_611, __p2_611, __p3_611) __extension__ ({ \
52849 int64x2_t __ret_611; \
52850 int64x2_t __s0_611 = __p0_611; \
52851 int32x4_t __s1_611 = __p1_611; \
52852 int32x4_t __s2_611 = __p2_611; \
52853 __ret_611 = vqdmlal_s32(__s0_611, vget_high_s32(__s1_611), splat_laneq_s32(__s2_611, __p3_611)); \
52854 __ret_611; \
52855})
52856#else
52857#define vqdmlal_high_laneq_s32(__p0_612, __p1_612, __p2_612, __p3_612) __extension__ ({ \
52858 int64x2_t __ret_612; \
52859 int64x2_t __s0_612 = __p0_612; \
52860 int32x4_t __s1_612 = __p1_612; \
52861 int32x4_t __s2_612 = __p2_612; \
52862 int64x2_t __rev0_612; __rev0_612 = __builtin_shufflevector(__s0_612, __s0_612, 1, 0); \
52863 int32x4_t __rev1_612; __rev1_612 = __builtin_shufflevector(__s1_612, __s1_612, 3, 2, 1, 0); \
52864 int32x4_t __rev2_612; __rev2_612 = __builtin_shufflevector(__s2_612, __s2_612, 3, 2, 1, 0); \
52865 __ret_612 = __noswap_vqdmlal_s32(__rev0_612, __noswap_vget_high_s32(__rev1_612), __noswap_splat_laneq_s32(__rev2_612, __p3_612)); \
52866 __ret_612 = __builtin_shufflevector(__ret_612, __ret_612, 1, 0); \
52867 __ret_612; \
52868})
52869#endif
52870
52871#ifdef __LITTLE_ENDIAN__
52872#define vqdmlal_high_laneq_s16(__p0_613, __p1_613, __p2_613, __p3_613) __extension__ ({ \
52873 int32x4_t __ret_613; \
52874 int32x4_t __s0_613 = __p0_613; \
52875 int16x8_t __s1_613 = __p1_613; \
52876 int16x8_t __s2_613 = __p2_613; \
52877 __ret_613 = vqdmlal_s16(__s0_613, vget_high_s16(__s1_613), splat_laneq_s16(__s2_613, __p3_613)); \
52878 __ret_613; \
52879})
52880#else
52881#define vqdmlal_high_laneq_s16(__p0_614, __p1_614, __p2_614, __p3_614) __extension__ ({ \
52882 int32x4_t __ret_614; \
52883 int32x4_t __s0_614 = __p0_614; \
52884 int16x8_t __s1_614 = __p1_614; \
52885 int16x8_t __s2_614 = __p2_614; \
52886 int32x4_t __rev0_614; __rev0_614 = __builtin_shufflevector(__s0_614, __s0_614, 3, 2, 1, 0); \
52887 int16x8_t __rev1_614; __rev1_614 = __builtin_shufflevector(__s1_614, __s1_614, 7, 6, 5, 4, 3, 2, 1, 0); \
52888 int16x8_t __rev2_614; __rev2_614 = __builtin_shufflevector(__s2_614, __s2_614, 7, 6, 5, 4, 3, 2, 1, 0); \
52889 __ret_614 = __noswap_vqdmlal_s16(__rev0_614, __noswap_vget_high_s16(__rev1_614), __noswap_splat_laneq_s16(__rev2_614, __p3_614)); \
52890 __ret_614 = __builtin_shufflevector(__ret_614, __ret_614, 3, 2, 1, 0); \
52891 __ret_614; \
52892})
52893#endif
52894
52895#ifdef __LITTLE_ENDIAN__
52896__ai int64x2_t vqdmlal_high_n_s32(int64x2_t __p0, int32x4_t __p1, int32_t __p2) {
52897 int64x2_t __ret;
52898 __ret = vqdmlal_n_s32(__p0, vget_high_s32(__p1), __p2);
5161052899 return __ret;
5161152900}
5161252901#else
51613__ai float32x4_t vdivq_f32(float32x4_t __p0, float32x4_t __p1) {
51614 float32x4_t __ret;
51615 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
51616 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
51617 __ret = __rev0 / __rev1;
51618 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
52902__ai int64x2_t vqdmlal_high_n_s32(int64x2_t __p0, int32x4_t __p1, int32_t __p2) {
52903 int64x2_t __ret;
52904 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
52905 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
52906 __ret = __noswap_vqdmlal_n_s32(__rev0, __noswap_vget_high_s32(__rev1), __p2);
52907 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
5161952908 return __ret;
5162052909}
5162152910#endif
5162252911
51623__ai float64x1_t vdiv_f64(float64x1_t __p0, float64x1_t __p1) {
51624 float64x1_t __ret;
51625 __ret = __p0 / __p1;
51626 return __ret;
51627}
5162852912#ifdef __LITTLE_ENDIAN__
51629__ai float32x2_t vdiv_f32(float32x2_t __p0, float32x2_t __p1) {
51630 float32x2_t __ret;
51631 __ret = __p0 / __p1;
52913__ai int32x4_t vqdmlal_high_n_s16(int32x4_t __p0, int16x8_t __p1, int16_t __p2) {
52914 int32x4_t __ret;
52915 __ret = vqdmlal_n_s16(__p0, vget_high_s16(__p1), __p2);
5163252916 return __ret;
5163352917}
5163452918#else
51635__ai float32x2_t vdiv_f32(float32x2_t __p0, float32x2_t __p1) {
51636 float32x2_t __ret;
51637 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
51638 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
51639 __ret = __rev0 / __rev1;
51640 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
52919__ai int32x4_t vqdmlal_high_n_s16(int32x4_t __p0, int16x8_t __p1, int16_t __p2) {
52920 int32x4_t __ret;
52921 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
52922 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
52923 __ret = __noswap_vqdmlal_n_s16(__rev0, __noswap_vget_high_s16(__rev1), __p2);
52924 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
5164152925 return __ret;
5164252926}
5164352927#endif
5164452928
5164552929#ifdef __LITTLE_ENDIAN__
51646#define vdupb_lane_p8(__p0, __p1) __extension__ ({ \
51647 poly8_t __ret; \
51648 poly8x8_t __s0 = __p0; \
51649 __ret = (poly8_t) __builtin_neon_vdupb_lane_i8((poly8x8_t)__s0, __p1); \
52930#define vqdmlals_lane_s32(__p0, __p1, __p2, __p3) __extension__ ({ \
52931 int64_t __ret; \
52932 int64_t __s0 = __p0; \
52933 int32_t __s1 = __p1; \
52934 int32x2_t __s2 = __p2; \
52935 __ret = (int64_t) __builtin_neon_vqdmlals_lane_s32(__s0, __s1, __s2, __p3); \
5165052936 __ret; \
5165152937})
5165252938#else
51653#define vdupb_lane_p8(__p0, __p1) __extension__ ({ \
51654 poly8_t __ret; \
51655 poly8x8_t __s0 = __p0; \
51656 poly8x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
51657 __ret = (poly8_t) __builtin_neon_vdupb_lane_i8((poly8x8_t)__rev0, __p1); \
52939#define vqdmlals_lane_s32(__p0, __p1, __p2, __p3) __extension__ ({ \
52940 int64_t __ret; \
52941 int64_t __s0 = __p0; \
52942 int32_t __s1 = __p1; \
52943 int32x2_t __s2 = __p2; \
52944 int32x2_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 1, 0); \
52945 __ret = (int64_t) __builtin_neon_vqdmlals_lane_s32(__s0, __s1, __rev2, __p3); \
5165852946 __ret; \
5165952947})
5166052948#endif
5166152949
5166252950#ifdef __LITTLE_ENDIAN__
51663#define vduph_lane_p16(__p0, __p1) __extension__ ({ \
51664 poly16_t __ret; \
51665 poly16x4_t __s0 = __p0; \
51666 __ret = (poly16_t) __builtin_neon_vduph_lane_i16((poly16x4_t)__s0, __p1); \
52951#define vqdmlalh_lane_s16(__p0, __p1, __p2, __p3) __extension__ ({ \
52952 int32_t __ret; \
52953 int32_t __s0 = __p0; \
52954 int16_t __s1 = __p1; \
52955 int16x4_t __s2 = __p2; \
52956 __ret = (int32_t) __builtin_neon_vqdmlalh_lane_s16(__s0, __s1, __s2, __p3); \
5166752957 __ret; \
5166852958})
5166952959#else
51670#define vduph_lane_p16(__p0, __p1) __extension__ ({ \
51671 poly16_t __ret; \
51672 poly16x4_t __s0 = __p0; \
51673 poly16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
51674 __ret = (poly16_t) __builtin_neon_vduph_lane_i16((poly16x4_t)__rev0, __p1); \
52960#define vqdmlalh_lane_s16(__p0, __p1, __p2, __p3) __extension__ ({ \
52961 int32_t __ret; \
52962 int32_t __s0 = __p0; \
52963 int16_t __s1 = __p1; \
52964 int16x4_t __s2 = __p2; \
52965 int16x4_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 3, 2, 1, 0); \
52966 __ret = (int32_t) __builtin_neon_vqdmlalh_lane_s16(__s0, __s1, __rev2, __p3); \
5167552967 __ret; \
5167652968})
5167752969#endif
5167852970
5167952971#ifdef __LITTLE_ENDIAN__
51680#define vdupb_lane_u8(__p0, __p1) __extension__ ({ \
51681 uint8_t __ret; \
51682 uint8x8_t __s0 = __p0; \
51683 __ret = (uint8_t) __builtin_neon_vdupb_lane_i8((int8x8_t)__s0, __p1); \
52972#define vqdmlals_laneq_s32(__p0, __p1, __p2, __p3) __extension__ ({ \
52973 int64_t __ret; \
52974 int64_t __s0 = __p0; \
52975 int32_t __s1 = __p1; \
52976 int32x4_t __s2 = __p2; \
52977 __ret = (int64_t) __builtin_neon_vqdmlals_laneq_s32(__s0, __s1, __s2, __p3); \
5168452978 __ret; \
5168552979})
5168652980#else
51687#define vdupb_lane_u8(__p0, __p1) __extension__ ({ \
51688 uint8_t __ret; \
51689 uint8x8_t __s0 = __p0; \
51690 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
51691 __ret = (uint8_t) __builtin_neon_vdupb_lane_i8((int8x8_t)__rev0, __p1); \
52981#define vqdmlals_laneq_s32(__p0, __p1, __p2, __p3) __extension__ ({ \
52982 int64_t __ret; \
52983 int64_t __s0 = __p0; \
52984 int32_t __s1 = __p1; \
52985 int32x4_t __s2 = __p2; \
52986 int32x4_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 3, 2, 1, 0); \
52987 __ret = (int64_t) __builtin_neon_vqdmlals_laneq_s32(__s0, __s1, __rev2, __p3); \
5169252988 __ret; \
5169352989})
5169452990#endif
5169552991
5169652992#ifdef __LITTLE_ENDIAN__
51697#define vdups_lane_u32(__p0, __p1) __extension__ ({ \
51698 uint32_t __ret; \
51699 uint32x2_t __s0 = __p0; \
51700 __ret = (uint32_t) __builtin_neon_vdups_lane_i32((int32x2_t)__s0, __p1); \
52993#define vqdmlalh_laneq_s16(__p0, __p1, __p2, __p3) __extension__ ({ \
52994 int32_t __ret; \
52995 int32_t __s0 = __p0; \
52996 int16_t __s1 = __p1; \
52997 int16x8_t __s2 = __p2; \
52998 __ret = (int32_t) __builtin_neon_vqdmlalh_laneq_s16(__s0, __s1, __s2, __p3); \
5170152999 __ret; \
5170253000})
5170353001#else
51704#define vdups_lane_u32(__p0, __p1) __extension__ ({ \
51705 uint32_t __ret; \
51706 uint32x2_t __s0 = __p0; \
51707 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
51708 __ret = (uint32_t) __builtin_neon_vdups_lane_i32((int32x2_t)__rev0, __p1); \
53002#define vqdmlalh_laneq_s16(__p0, __p1, __p2, __p3) __extension__ ({ \
53003 int32_t __ret; \
53004 int32_t __s0 = __p0; \
53005 int16_t __s1 = __p1; \
53006 int16x8_t __s2 = __p2; \
53007 int16x8_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 7, 6, 5, 4, 3, 2, 1, 0); \
53008 __ret = (int32_t) __builtin_neon_vqdmlalh_laneq_s16(__s0, __s1, __rev2, __p3); \
5170953009 __ret; \
5171053010})
5171153011#endif
5171253012
51713#define vdupd_lane_u64(__p0, __p1) __extension__ ({ \
51714 uint64_t __ret; \
51715 uint64x1_t __s0 = __p0; \
51716 __ret = (uint64_t) __builtin_neon_vdupd_lane_i64((int64x1_t)__s0, __p1); \
51717 __ret; \
51718})
5171953013#ifdef __LITTLE_ENDIAN__
51720#define vduph_lane_u16(__p0, __p1) __extension__ ({ \
51721 uint16_t __ret; \
51722 uint16x4_t __s0 = __p0; \
51723 __ret = (uint16_t) __builtin_neon_vduph_lane_i16((int16x4_t)__s0, __p1); \
51724 __ret; \
53014#define vqdmlal_laneq_s32(__p0_615, __p1_615, __p2_615, __p3_615) __extension__ ({ \
53015 int64x2_t __ret_615; \
53016 int64x2_t __s0_615 = __p0_615; \
53017 int32x2_t __s1_615 = __p1_615; \
53018 int32x4_t __s2_615 = __p2_615; \
53019 __ret_615 = vqdmlal_s32(__s0_615, __s1_615, splat_laneq_s32(__s2_615, __p3_615)); \
53020 __ret_615; \
5172553021})
5172653022#else
51727#define vduph_lane_u16(__p0, __p1) __extension__ ({ \
51728 uint16_t __ret; \
51729 uint16x4_t __s0 = __p0; \
51730 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
51731 __ret = (uint16_t) __builtin_neon_vduph_lane_i16((int16x4_t)__rev0, __p1); \
51732 __ret; \
53023#define vqdmlal_laneq_s32(__p0_616, __p1_616, __p2_616, __p3_616) __extension__ ({ \
53024 int64x2_t __ret_616; \
53025 int64x2_t __s0_616 = __p0_616; \
53026 int32x2_t __s1_616 = __p1_616; \
53027 int32x4_t __s2_616 = __p2_616; \
53028 int64x2_t __rev0_616; __rev0_616 = __builtin_shufflevector(__s0_616, __s0_616, 1, 0); \
53029 int32x2_t __rev1_616; __rev1_616 = __builtin_shufflevector(__s1_616, __s1_616, 1, 0); \
53030 int32x4_t __rev2_616; __rev2_616 = __builtin_shufflevector(__s2_616, __s2_616, 3, 2, 1, 0); \
53031 __ret_616 = __noswap_vqdmlal_s32(__rev0_616, __rev1_616, __noswap_splat_laneq_s32(__rev2_616, __p3_616)); \
53032 __ret_616 = __builtin_shufflevector(__ret_616, __ret_616, 1, 0); \
53033 __ret_616; \
5173353034})
5173453035#endif
5173553036
5173653037#ifdef __LITTLE_ENDIAN__
51737#define vdupb_lane_s8(__p0, __p1) __extension__ ({ \
51738 int8_t __ret; \
51739 int8x8_t __s0 = __p0; \
51740 __ret = (int8_t) __builtin_neon_vdupb_lane_i8((int8x8_t)__s0, __p1); \
51741 __ret; \
53038#define vqdmlal_laneq_s16(__p0_617, __p1_617, __p2_617, __p3_617) __extension__ ({ \
53039 int32x4_t __ret_617; \
53040 int32x4_t __s0_617 = __p0_617; \
53041 int16x4_t __s1_617 = __p1_617; \
53042 int16x8_t __s2_617 = __p2_617; \
53043 __ret_617 = vqdmlal_s16(__s0_617, __s1_617, splat_laneq_s16(__s2_617, __p3_617)); \
53044 __ret_617; \
5174253045})
5174353046#else
51744#define vdupb_lane_s8(__p0, __p1) __extension__ ({ \
51745 int8_t __ret; \
51746 int8x8_t __s0 = __p0; \
51747 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
51748 __ret = (int8_t) __builtin_neon_vdupb_lane_i8((int8x8_t)__rev0, __p1); \
51749 __ret; \
53047#define vqdmlal_laneq_s16(__p0_618, __p1_618, __p2_618, __p3_618) __extension__ ({ \
53048 int32x4_t __ret_618; \
53049 int32x4_t __s0_618 = __p0_618; \
53050 int16x4_t __s1_618 = __p1_618; \
53051 int16x8_t __s2_618 = __p2_618; \
53052 int32x4_t __rev0_618; __rev0_618 = __builtin_shufflevector(__s0_618, __s0_618, 3, 2, 1, 0); \
53053 int16x4_t __rev1_618; __rev1_618 = __builtin_shufflevector(__s1_618, __s1_618, 3, 2, 1, 0); \
53054 int16x8_t __rev2_618; __rev2_618 = __builtin_shufflevector(__s2_618, __s2_618, 7, 6, 5, 4, 3, 2, 1, 0); \
53055 __ret_618 = __noswap_vqdmlal_s16(__rev0_618, __rev1_618, __noswap_splat_laneq_s16(__rev2_618, __p3_618)); \
53056 __ret_618 = __builtin_shufflevector(__ret_618, __ret_618, 3, 2, 1, 0); \
53057 __ret_618; \
5175053058})
5175153059#endif
5175253060
51753#define vdupd_lane_f64(__p0, __p1) __extension__ ({ \
51754 float64_t __ret; \
51755 float64x1_t __s0 = __p0; \
51756 __ret = (float64_t) __builtin_neon_vdupd_lane_f64((float64x1_t)__s0, __p1); \
51757 __ret; \
51758})
53061__ai int64_t vqdmlsls_s32(int64_t __p0, int32_t __p1, int32_t __p2) {
53062 int64_t __ret;
53063 __ret = (int64_t) __builtin_neon_vqdmlsls_s32(__p0, __p1, __p2);
53064 return __ret;
53065}
53066__ai int32_t vqdmlslh_s16(int32_t __p0, int16_t __p1, int16_t __p2) {
53067 int32_t __ret;
53068 __ret = (int32_t) __builtin_neon_vqdmlslh_s16(__p0, __p1, __p2);
53069 return __ret;
53070}
5175953071#ifdef __LITTLE_ENDIAN__
51760#define vdups_lane_f32(__p0, __p1) __extension__ ({ \
51761 float32_t __ret; \
51762 float32x2_t __s0 = __p0; \
51763 __ret = (float32_t) __builtin_neon_vdups_lane_f32((float32x2_t)__s0, __p1); \
51764 __ret; \
51765})
53072__ai int64x2_t vqdmlsl_high_s32(int64x2_t __p0, int32x4_t __p1, int32x4_t __p2) {
53073 int64x2_t __ret;
53074 __ret = vqdmlsl_s32(__p0, vget_high_s32(__p1), vget_high_s32(__p2));
53075 return __ret;
53076}
5176653077#else
51767#define vdups_lane_f32(__p0, __p1) __extension__ ({ \
51768 float32_t __ret; \
51769 float32x2_t __s0 = __p0; \
51770 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
51771 __ret = (float32_t) __builtin_neon_vdups_lane_f32((float32x2_t)__rev0, __p1); \
51772 __ret; \
51773})
53078__ai int64x2_t vqdmlsl_high_s32(int64x2_t __p0, int32x4_t __p1, int32x4_t __p2) {
53079 int64x2_t __ret;
53080 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
53081 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
53082 int32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
53083 __ret = __noswap_vqdmlsl_s32(__rev0, __noswap_vget_high_s32(__rev1), __noswap_vget_high_s32(__rev2));
53084 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
53085 return __ret;
53086}
5177453087#endif
5177553088
5177653089#ifdef __LITTLE_ENDIAN__
51777#define vdups_lane_s32(__p0, __p1) __extension__ ({ \
51778 int32_t __ret; \
51779 int32x2_t __s0 = __p0; \
51780 __ret = (int32_t) __builtin_neon_vdups_lane_i32((int32x2_t)__s0, __p1); \
51781 __ret; \
51782})
53090__ai int32x4_t vqdmlsl_high_s16(int32x4_t __p0, int16x8_t __p1, int16x8_t __p2) {
53091 int32x4_t __ret;
53092 __ret = vqdmlsl_s16(__p0, vget_high_s16(__p1), vget_high_s16(__p2));
53093 return __ret;
53094}
5178353095#else
51784#define vdups_lane_s32(__p0, __p1) __extension__ ({ \
51785 int32_t __ret; \
51786 int32x2_t __s0 = __p0; \
51787 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
51788 __ret = (int32_t) __builtin_neon_vdups_lane_i32((int32x2_t)__rev0, __p1); \
51789 __ret; \
51790})
53096__ai int32x4_t vqdmlsl_high_s16(int32x4_t __p0, int16x8_t __p1, int16x8_t __p2) {
53097 int32x4_t __ret;
53098 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
53099 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
53100 int16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
53101 __ret = __noswap_vqdmlsl_s16(__rev0, __noswap_vget_high_s16(__rev1), __noswap_vget_high_s16(__rev2));
53102 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
53103 return __ret;
53104}
5179153105#endif
5179253106
51793#define vdupd_lane_s64(__p0, __p1) __extension__ ({ \
51794 int64_t __ret; \
51795 int64x1_t __s0 = __p0; \
51796 __ret = (int64_t) __builtin_neon_vdupd_lane_i64((int64x1_t)__s0, __p1); \
51797 __ret; \
51798})
5179953107#ifdef __LITTLE_ENDIAN__
51800#define vduph_lane_s16(__p0, __p1) __extension__ ({ \
51801 int16_t __ret; \
51802 int16x4_t __s0 = __p0; \
51803 __ret = (int16_t) __builtin_neon_vduph_lane_i16((int16x4_t)__s0, __p1); \
51804 __ret; \
53108#define vqdmlsl_high_lane_s32(__p0_619, __p1_619, __p2_619, __p3_619) __extension__ ({ \
53109 int64x2_t __ret_619; \
53110 int64x2_t __s0_619 = __p0_619; \
53111 int32x4_t __s1_619 = __p1_619; \
53112 int32x2_t __s2_619 = __p2_619; \
53113 __ret_619 = vqdmlsl_s32(__s0_619, vget_high_s32(__s1_619), splat_lane_s32(__s2_619, __p3_619)); \
53114 __ret_619; \
5180553115})
5180653116#else
51807#define vduph_lane_s16(__p0, __p1) __extension__ ({ \
51808 int16_t __ret; \
51809 int16x4_t __s0 = __p0; \
51810 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
51811 __ret = (int16_t) __builtin_neon_vduph_lane_i16((int16x4_t)__rev0, __p1); \
51812 __ret; \
53117#define vqdmlsl_high_lane_s32(__p0_620, __p1_620, __p2_620, __p3_620) __extension__ ({ \
53118 int64x2_t __ret_620; \
53119 int64x2_t __s0_620 = __p0_620; \
53120 int32x4_t __s1_620 = __p1_620; \
53121 int32x2_t __s2_620 = __p2_620; \
53122 int64x2_t __rev0_620; __rev0_620 = __builtin_shufflevector(__s0_620, __s0_620, 1, 0); \
53123 int32x4_t __rev1_620; __rev1_620 = __builtin_shufflevector(__s1_620, __s1_620, 3, 2, 1, 0); \
53124 int32x2_t __rev2_620; __rev2_620 = __builtin_shufflevector(__s2_620, __s2_620, 1, 0); \
53125 __ret_620 = __noswap_vqdmlsl_s32(__rev0_620, __noswap_vget_high_s32(__rev1_620), __noswap_splat_lane_s32(__rev2_620, __p3_620)); \
53126 __ret_620 = __builtin_shufflevector(__ret_620, __ret_620, 1, 0); \
53127 __ret_620; \
5181353128})
5181453129#endif
5181553130
51816#define vdup_lane_p64(__p0_443, __p1_443) __extension__ ({ \
51817 poly64x1_t __ret_443; \
51818 poly64x1_t __s0_443 = __p0_443; \
51819 __ret_443 = splat_lane_p64(__s0_443, __p1_443); \
51820 __ret_443; \
51821})
5182253131#ifdef __LITTLE_ENDIAN__
51823#define vdupq_lane_p64(__p0_444, __p1_444) __extension__ ({ \
51824 poly64x2_t __ret_444; \
51825 poly64x1_t __s0_444 = __p0_444; \
51826 __ret_444 = splatq_lane_p64(__s0_444, __p1_444); \
51827 __ret_444; \
53132#define vqdmlsl_high_lane_s16(__p0_621, __p1_621, __p2_621, __p3_621) __extension__ ({ \
53133 int32x4_t __ret_621; \
53134 int32x4_t __s0_621 = __p0_621; \
53135 int16x8_t __s1_621 = __p1_621; \
53136 int16x4_t __s2_621 = __p2_621; \
53137 __ret_621 = vqdmlsl_s16(__s0_621, vget_high_s16(__s1_621), splat_lane_s16(__s2_621, __p3_621)); \
53138 __ret_621; \
5182853139})
5182953140#else
51830#define vdupq_lane_p64(__p0_445, __p1_445) __extension__ ({ \
51831 poly64x2_t __ret_445; \
51832 poly64x1_t __s0_445 = __p0_445; \
51833 __ret_445 = __noswap_splatq_lane_p64(__s0_445, __p1_445); \
51834 __ret_445 = __builtin_shufflevector(__ret_445, __ret_445, 1, 0); \
51835 __ret_445; \
53141#define vqdmlsl_high_lane_s16(__p0_622, __p1_622, __p2_622, __p3_622) __extension__ ({ \
53142 int32x4_t __ret_622; \
53143 int32x4_t __s0_622 = __p0_622; \
53144 int16x8_t __s1_622 = __p1_622; \
53145 int16x4_t __s2_622 = __p2_622; \
53146 int32x4_t __rev0_622; __rev0_622 = __builtin_shufflevector(__s0_622, __s0_622, 3, 2, 1, 0); \
53147 int16x8_t __rev1_622; __rev1_622 = __builtin_shufflevector(__s1_622, __s1_622, 7, 6, 5, 4, 3, 2, 1, 0); \
53148 int16x4_t __rev2_622; __rev2_622 = __builtin_shufflevector(__s2_622, __s2_622, 3, 2, 1, 0); \
53149 __ret_622 = __noswap_vqdmlsl_s16(__rev0_622, __noswap_vget_high_s16(__rev1_622), __noswap_splat_lane_s16(__rev2_622, __p3_622)); \
53150 __ret_622 = __builtin_shufflevector(__ret_622, __ret_622, 3, 2, 1, 0); \
53151 __ret_622; \
5183653152})
5183753153#endif
5183853154
5183953155#ifdef __LITTLE_ENDIAN__
51840#define vdupq_lane_f64(__p0_446, __p1_446) __extension__ ({ \
51841 float64x2_t __ret_446; \
51842 float64x1_t __s0_446 = __p0_446; \
51843 __ret_446 = splatq_lane_f64(__s0_446, __p1_446); \
51844 __ret_446; \
53156#define vqdmlsl_high_laneq_s32(__p0_623, __p1_623, __p2_623, __p3_623) __extension__ ({ \
53157 int64x2_t __ret_623; \
53158 int64x2_t __s0_623 = __p0_623; \
53159 int32x4_t __s1_623 = __p1_623; \
53160 int32x4_t __s2_623 = __p2_623; \
53161 __ret_623 = vqdmlsl_s32(__s0_623, vget_high_s32(__s1_623), splat_laneq_s32(__s2_623, __p3_623)); \
53162 __ret_623; \
5184553163})
5184653164#else
51847#define vdupq_lane_f64(__p0_447, __p1_447) __extension__ ({ \
51848 float64x2_t __ret_447; \
51849 float64x1_t __s0_447 = __p0_447; \
51850 __ret_447 = __noswap_splatq_lane_f64(__s0_447, __p1_447); \
51851 __ret_447 = __builtin_shufflevector(__ret_447, __ret_447, 1, 0); \
51852 __ret_447; \
53165#define vqdmlsl_high_laneq_s32(__p0_624, __p1_624, __p2_624, __p3_624) __extension__ ({ \
53166 int64x2_t __ret_624; \
53167 int64x2_t __s0_624 = __p0_624; \
53168 int32x4_t __s1_624 = __p1_624; \
53169 int32x4_t __s2_624 = __p2_624; \
53170 int64x2_t __rev0_624; __rev0_624 = __builtin_shufflevector(__s0_624, __s0_624, 1, 0); \
53171 int32x4_t __rev1_624; __rev1_624 = __builtin_shufflevector(__s1_624, __s1_624, 3, 2, 1, 0); \
53172 int32x4_t __rev2_624; __rev2_624 = __builtin_shufflevector(__s2_624, __s2_624, 3, 2, 1, 0); \
53173 __ret_624 = __noswap_vqdmlsl_s32(__rev0_624, __noswap_vget_high_s32(__rev1_624), __noswap_splat_laneq_s32(__rev2_624, __p3_624)); \
53174 __ret_624 = __builtin_shufflevector(__ret_624, __ret_624, 1, 0); \
53175 __ret_624; \
5185353176})
5185453177#endif
5185553178
5185653179#ifdef __LITTLE_ENDIAN__
51857#define vdupq_lane_f16(__p0_448, __p1_448) __extension__ ({ \
51858 float16x8_t __ret_448; \
51859 float16x4_t __s0_448 = __p0_448; \
51860 __ret_448 = splatq_lane_f16(__s0_448, __p1_448); \
51861 __ret_448; \
53180#define vqdmlsl_high_laneq_s16(__p0_625, __p1_625, __p2_625, __p3_625) __extension__ ({ \
53181 int32x4_t __ret_625; \
53182 int32x4_t __s0_625 = __p0_625; \
53183 int16x8_t __s1_625 = __p1_625; \
53184 int16x8_t __s2_625 = __p2_625; \
53185 __ret_625 = vqdmlsl_s16(__s0_625, vget_high_s16(__s1_625), splat_laneq_s16(__s2_625, __p3_625)); \
53186 __ret_625; \
5186253187})
5186353188#else
51864#define vdupq_lane_f16(__p0_449, __p1_449) __extension__ ({ \
51865 float16x8_t __ret_449; \
51866 float16x4_t __s0_449 = __p0_449; \
51867 float16x4_t __rev0_449; __rev0_449 = __builtin_shufflevector(__s0_449, __s0_449, 3, 2, 1, 0); \
51868 __ret_449 = __noswap_splatq_lane_f16(__rev0_449, __p1_449); \
51869 __ret_449 = __builtin_shufflevector(__ret_449, __ret_449, 7, 6, 5, 4, 3, 2, 1, 0); \
51870 __ret_449; \
53189#define vqdmlsl_high_laneq_s16(__p0_626, __p1_626, __p2_626, __p3_626) __extension__ ({ \
53190 int32x4_t __ret_626; \
53191 int32x4_t __s0_626 = __p0_626; \
53192 int16x8_t __s1_626 = __p1_626; \
53193 int16x8_t __s2_626 = __p2_626; \
53194 int32x4_t __rev0_626; __rev0_626 = __builtin_shufflevector(__s0_626, __s0_626, 3, 2, 1, 0); \
53195 int16x8_t __rev1_626; __rev1_626 = __builtin_shufflevector(__s1_626, __s1_626, 7, 6, 5, 4, 3, 2, 1, 0); \
53196 int16x8_t __rev2_626; __rev2_626 = __builtin_shufflevector(__s2_626, __s2_626, 7, 6, 5, 4, 3, 2, 1, 0); \
53197 __ret_626 = __noswap_vqdmlsl_s16(__rev0_626, __noswap_vget_high_s16(__rev1_626), __noswap_splat_laneq_s16(__rev2_626, __p3_626)); \
53198 __ret_626 = __builtin_shufflevector(__ret_626, __ret_626, 3, 2, 1, 0); \
53199 __ret_626; \
5187153200})
5187253201#endif
5187353202
51874#define vdup_lane_f64(__p0_450, __p1_450) __extension__ ({ \
51875 float64x1_t __ret_450; \
51876 float64x1_t __s0_450 = __p0_450; \
51877 __ret_450 = splat_lane_f64(__s0_450, __p1_450); \
51878 __ret_450; \
51879})
5188053203#ifdef __LITTLE_ENDIAN__
51881#define vdup_lane_f16(__p0_451, __p1_451) __extension__ ({ \
51882 float16x4_t __ret_451; \
51883 float16x4_t __s0_451 = __p0_451; \
51884 __ret_451 = splat_lane_f16(__s0_451, __p1_451); \
51885 __ret_451; \
53204__ai int64x2_t vqdmlsl_high_n_s32(int64x2_t __p0, int32x4_t __p1, int32_t __p2) {
53205 int64x2_t __ret;
53206 __ret = vqdmlsl_n_s32(__p0, vget_high_s32(__p1), __p2);
53207 return __ret;
53208}
53209#else
53210__ai int64x2_t vqdmlsl_high_n_s32(int64x2_t __p0, int32x4_t __p1, int32_t __p2) {
53211 int64x2_t __ret;
53212 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
53213 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
53214 __ret = __noswap_vqdmlsl_n_s32(__rev0, __noswap_vget_high_s32(__rev1), __p2);
53215 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
53216 return __ret;
53217}
53218#endif
53219
53220#ifdef __LITTLE_ENDIAN__
53221__ai int32x4_t vqdmlsl_high_n_s16(int32x4_t __p0, int16x8_t __p1, int16_t __p2) {
53222 int32x4_t __ret;
53223 __ret = vqdmlsl_n_s16(__p0, vget_high_s16(__p1), __p2);
53224 return __ret;
53225}
53226#else
53227__ai int32x4_t vqdmlsl_high_n_s16(int32x4_t __p0, int16x8_t __p1, int16_t __p2) {
53228 int32x4_t __ret;
53229 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
53230 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
53231 __ret = __noswap_vqdmlsl_n_s16(__rev0, __noswap_vget_high_s16(__rev1), __p2);
53232 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
53233 return __ret;
53234}
53235#endif
53236
53237#ifdef __LITTLE_ENDIAN__
53238#define vqdmlsls_lane_s32(__p0, __p1, __p2, __p3) __extension__ ({ \
53239 int64_t __ret; \
53240 int64_t __s0 = __p0; \
53241 int32_t __s1 = __p1; \
53242 int32x2_t __s2 = __p2; \
53243 __ret = (int64_t) __builtin_neon_vqdmlsls_lane_s32(__s0, __s1, __s2, __p3); \
53244 __ret; \
5188653245})
5188753246#else
51888#define vdup_lane_f16(__p0_452, __p1_452) __extension__ ({ \
51889 float16x4_t __ret_452; \
51890 float16x4_t __s0_452 = __p0_452; \
51891 float16x4_t __rev0_452; __rev0_452 = __builtin_shufflevector(__s0_452, __s0_452, 3, 2, 1, 0); \
51892 __ret_452 = __noswap_splat_lane_f16(__rev0_452, __p1_452); \
51893 __ret_452 = __builtin_shufflevector(__ret_452, __ret_452, 3, 2, 1, 0); \
51894 __ret_452; \
53247#define vqdmlsls_lane_s32(__p0, __p1, __p2, __p3) __extension__ ({ \
53248 int64_t __ret; \
53249 int64_t __s0 = __p0; \
53250 int32_t __s1 = __p1; \
53251 int32x2_t __s2 = __p2; \
53252 int32x2_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 1, 0); \
53253 __ret = (int64_t) __builtin_neon_vqdmlsls_lane_s32(__s0, __s1, __rev2, __p3); \
53254 __ret; \
5189553255})
5189653256#endif
5189753257
5189853258#ifdef __LITTLE_ENDIAN__
51899#define vdupb_laneq_p8(__p0, __p1) __extension__ ({ \
51900 poly8_t __ret; \
51901 poly8x16_t __s0 = __p0; \
51902 __ret = (poly8_t) __builtin_neon_vdupb_laneq_i8((poly8x16_t)__s0, __p1); \
53259#define vqdmlslh_lane_s16(__p0, __p1, __p2, __p3) __extension__ ({ \
53260 int32_t __ret; \
53261 int32_t __s0 = __p0; \
53262 int16_t __s1 = __p1; \
53263 int16x4_t __s2 = __p2; \
53264 __ret = (int32_t) __builtin_neon_vqdmlslh_lane_s16(__s0, __s1, __s2, __p3); \
5190353265 __ret; \
5190453266})
5190553267#else
51906#define vdupb_laneq_p8(__p0, __p1) __extension__ ({ \
51907 poly8_t __ret; \
51908 poly8x16_t __s0 = __p0; \
51909 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
51910 __ret = (poly8_t) __builtin_neon_vdupb_laneq_i8((poly8x16_t)__rev0, __p1); \
53268#define vqdmlslh_lane_s16(__p0, __p1, __p2, __p3) __extension__ ({ \
53269 int32_t __ret; \
53270 int32_t __s0 = __p0; \
53271 int16_t __s1 = __p1; \
53272 int16x4_t __s2 = __p2; \
53273 int16x4_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 3, 2, 1, 0); \
53274 __ret = (int32_t) __builtin_neon_vqdmlslh_lane_s16(__s0, __s1, __rev2, __p3); \
5191153275 __ret; \
5191253276})
5191353277#endif
5191453278
5191553279#ifdef __LITTLE_ENDIAN__
51916#define vduph_laneq_p16(__p0, __p1) __extension__ ({ \
51917 poly16_t __ret; \
51918 poly16x8_t __s0 = __p0; \
51919 __ret = (poly16_t) __builtin_neon_vduph_laneq_i16((poly16x8_t)__s0, __p1); \
53280#define vqdmlsls_laneq_s32(__p0, __p1, __p2, __p3) __extension__ ({ \
53281 int64_t __ret; \
53282 int64_t __s0 = __p0; \
53283 int32_t __s1 = __p1; \
53284 int32x4_t __s2 = __p2; \
53285 __ret = (int64_t) __builtin_neon_vqdmlsls_laneq_s32(__s0, __s1, __s2, __p3); \
5192053286 __ret; \
5192153287})
5192253288#else
51923#define vduph_laneq_p16(__p0, __p1) __extension__ ({ \
51924 poly16_t __ret; \
51925 poly16x8_t __s0 = __p0; \
51926 poly16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
51927 __ret = (poly16_t) __builtin_neon_vduph_laneq_i16((poly16x8_t)__rev0, __p1); \
53289#define vqdmlsls_laneq_s32(__p0, __p1, __p2, __p3) __extension__ ({ \
53290 int64_t __ret; \
53291 int64_t __s0 = __p0; \
53292 int32_t __s1 = __p1; \
53293 int32x4_t __s2 = __p2; \
53294 int32x4_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 3, 2, 1, 0); \
53295 __ret = (int64_t) __builtin_neon_vqdmlsls_laneq_s32(__s0, __s1, __rev2, __p3); \
5192853296 __ret; \
5192953297})
5193053298#endif
5193153299
5193253300#ifdef __LITTLE_ENDIAN__
51933#define vdupb_laneq_u8(__p0, __p1) __extension__ ({ \
51934 uint8_t __ret; \
51935 uint8x16_t __s0 = __p0; \
51936 __ret = (uint8_t) __builtin_neon_vdupb_laneq_i8((int8x16_t)__s0, __p1); \
53301#define vqdmlslh_laneq_s16(__p0, __p1, __p2, __p3) __extension__ ({ \
53302 int32_t __ret; \
53303 int32_t __s0 = __p0; \
53304 int16_t __s1 = __p1; \
53305 int16x8_t __s2 = __p2; \
53306 __ret = (int32_t) __builtin_neon_vqdmlslh_laneq_s16(__s0, __s1, __s2, __p3); \
5193753307 __ret; \
5193853308})
5193953309#else
51940#define vdupb_laneq_u8(__p0, __p1) __extension__ ({ \
51941 uint8_t __ret; \
51942 uint8x16_t __s0 = __p0; \
51943 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
51944 __ret = (uint8_t) __builtin_neon_vdupb_laneq_i8((int8x16_t)__rev0, __p1); \
53310#define vqdmlslh_laneq_s16(__p0, __p1, __p2, __p3) __extension__ ({ \
53311 int32_t __ret; \
53312 int32_t __s0 = __p0; \
53313 int16_t __s1 = __p1; \
53314 int16x8_t __s2 = __p2; \
53315 int16x8_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 7, 6, 5, 4, 3, 2, 1, 0); \
53316 __ret = (int32_t) __builtin_neon_vqdmlslh_laneq_s16(__s0, __s1, __rev2, __p3); \
5194553317 __ret; \
5194653318})
5194753319#endif
5194853320
5194953321#ifdef __LITTLE_ENDIAN__
51950#define vdups_laneq_u32(__p0, __p1) __extension__ ({ \
51951 uint32_t __ret; \
51952 uint32x4_t __s0 = __p0; \
51953 __ret = (uint32_t) __builtin_neon_vdups_laneq_i32((int32x4_t)__s0, __p1); \
53322#define vqdmlsl_laneq_s32(__p0_627, __p1_627, __p2_627, __p3_627) __extension__ ({ \
53323 int64x2_t __ret_627; \
53324 int64x2_t __s0_627 = __p0_627; \
53325 int32x2_t __s1_627 = __p1_627; \
53326 int32x4_t __s2_627 = __p2_627; \
53327 __ret_627 = vqdmlsl_s32(__s0_627, __s1_627, splat_laneq_s32(__s2_627, __p3_627)); \
53328 __ret_627; \
53329})
53330#else
53331#define vqdmlsl_laneq_s32(__p0_628, __p1_628, __p2_628, __p3_628) __extension__ ({ \
53332 int64x2_t __ret_628; \
53333 int64x2_t __s0_628 = __p0_628; \
53334 int32x2_t __s1_628 = __p1_628; \
53335 int32x4_t __s2_628 = __p2_628; \
53336 int64x2_t __rev0_628; __rev0_628 = __builtin_shufflevector(__s0_628, __s0_628, 1, 0); \
53337 int32x2_t __rev1_628; __rev1_628 = __builtin_shufflevector(__s1_628, __s1_628, 1, 0); \
53338 int32x4_t __rev2_628; __rev2_628 = __builtin_shufflevector(__s2_628, __s2_628, 3, 2, 1, 0); \
53339 __ret_628 = __noswap_vqdmlsl_s32(__rev0_628, __rev1_628, __noswap_splat_laneq_s32(__rev2_628, __p3_628)); \
53340 __ret_628 = __builtin_shufflevector(__ret_628, __ret_628, 1, 0); \
53341 __ret_628; \
53342})
53343#endif
53344
53345#ifdef __LITTLE_ENDIAN__
53346#define vqdmlsl_laneq_s16(__p0_629, __p1_629, __p2_629, __p3_629) __extension__ ({ \
53347 int32x4_t __ret_629; \
53348 int32x4_t __s0_629 = __p0_629; \
53349 int16x4_t __s1_629 = __p1_629; \
53350 int16x8_t __s2_629 = __p2_629; \
53351 __ret_629 = vqdmlsl_s16(__s0_629, __s1_629, splat_laneq_s16(__s2_629, __p3_629)); \
53352 __ret_629; \
53353})
53354#else
53355#define vqdmlsl_laneq_s16(__p0_630, __p1_630, __p2_630, __p3_630) __extension__ ({ \
53356 int32x4_t __ret_630; \
53357 int32x4_t __s0_630 = __p0_630; \
53358 int16x4_t __s1_630 = __p1_630; \
53359 int16x8_t __s2_630 = __p2_630; \
53360 int32x4_t __rev0_630; __rev0_630 = __builtin_shufflevector(__s0_630, __s0_630, 3, 2, 1, 0); \
53361 int16x4_t __rev1_630; __rev1_630 = __builtin_shufflevector(__s1_630, __s1_630, 3, 2, 1, 0); \
53362 int16x8_t __rev2_630; __rev2_630 = __builtin_shufflevector(__s2_630, __s2_630, 7, 6, 5, 4, 3, 2, 1, 0); \
53363 __ret_630 = __noswap_vqdmlsl_s16(__rev0_630, __rev1_630, __noswap_splat_laneq_s16(__rev2_630, __p3_630)); \
53364 __ret_630 = __builtin_shufflevector(__ret_630, __ret_630, 3, 2, 1, 0); \
53365 __ret_630; \
53366})
53367#endif
53368
53369__ai int32_t vqdmulhs_s32(int32_t __p0, int32_t __p1) {
53370 int32_t __ret;
53371 __ret = (int32_t) __builtin_neon_vqdmulhs_s32(__p0, __p1);
53372 return __ret;
53373}
53374__ai int16_t vqdmulhh_s16(int16_t __p0, int16_t __p1) {
53375 int16_t __ret;
53376 __ret = (int16_t) __builtin_neon_vqdmulhh_s16(__p0, __p1);
53377 return __ret;
53378}
53379#ifdef __LITTLE_ENDIAN__
53380#define vqdmulhq_lane_s32(__p0, __p1, __p2) __extension__ ({ \
53381 int32x4_t __ret; \
53382 int32x4_t __s0 = __p0; \
53383 int32x2_t __s1 = __p1; \
53384 __ret = (int32x4_t) __builtin_neon_vqdmulhq_lane_v((int8x16_t)__s0, (int8x8_t)__s1, __p2, 2); \
5195453385 __ret; \
5195553386})
5195653387#else
51957#define vdups_laneq_u32(__p0, __p1) __extension__ ({ \
51958 uint32_t __ret; \
51959 uint32x4_t __s0 = __p0; \
51960 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
51961 __ret = (uint32_t) __builtin_neon_vdups_laneq_i32((int32x4_t)__rev0, __p1); \
53388#define vqdmulhq_lane_s32(__p0, __p1, __p2) __extension__ ({ \
53389 int32x4_t __ret; \
53390 int32x4_t __s0 = __p0; \
53391 int32x2_t __s1 = __p1; \
53392 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
53393 int32x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
53394 __ret = (int32x4_t) __builtin_neon_vqdmulhq_lane_v((int8x16_t)__rev0, (int8x8_t)__rev1, __p2, 2); \
53395 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
5196253396 __ret; \
5196353397})
5196453398#endif
5196553399
5196653400#ifdef __LITTLE_ENDIAN__
51967#define vdupd_laneq_u64(__p0, __p1) __extension__ ({ \
51968 uint64_t __ret; \
51969 uint64x2_t __s0 = __p0; \
51970 __ret = (uint64_t) __builtin_neon_vdupd_laneq_i64((int64x2_t)__s0, __p1); \
53401#define vqdmulhq_lane_s16(__p0, __p1, __p2) __extension__ ({ \
53402 int16x8_t __ret; \
53403 int16x8_t __s0 = __p0; \
53404 int16x4_t __s1 = __p1; \
53405 __ret = (int16x8_t) __builtin_neon_vqdmulhq_lane_v((int8x16_t)__s0, (int8x8_t)__s1, __p2, 1); \
5197153406 __ret; \
5197253407})
5197353408#else
51974#define vdupd_laneq_u64(__p0, __p1) __extension__ ({ \
51975 uint64_t __ret; \
51976 uint64x2_t __s0 = __p0; \
51977 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
51978 __ret = (uint64_t) __builtin_neon_vdupd_laneq_i64((int64x2_t)__rev0, __p1); \
53409#define vqdmulhq_lane_s16(__p0, __p1, __p2) __extension__ ({ \
53410 int16x8_t __ret; \
53411 int16x8_t __s0 = __p0; \
53412 int16x4_t __s1 = __p1; \
53413 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
53414 int16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
53415 __ret = (int16x8_t) __builtin_neon_vqdmulhq_lane_v((int8x16_t)__rev0, (int8x8_t)__rev1, __p2, 1); \
53416 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
5197953417 __ret; \
5198053418})
5198153419#endif
5198253420
5198353421#ifdef __LITTLE_ENDIAN__
51984#define vduph_laneq_u16(__p0, __p1) __extension__ ({ \
51985 uint16_t __ret; \
51986 uint16x8_t __s0 = __p0; \
51987 __ret = (uint16_t) __builtin_neon_vduph_laneq_i16((int16x8_t)__s0, __p1); \
53422#define vqdmulh_lane_s32(__p0, __p1, __p2) __extension__ ({ \
53423 int32x2_t __ret; \
53424 int32x2_t __s0 = __p0; \
53425 int32x2_t __s1 = __p1; \
53426 __ret = (int32x2_t) __builtin_neon_vqdmulh_lane_v((int8x8_t)__s0, (int8x8_t)__s1, __p2, 2); \
5198853427 __ret; \
5198953428})
5199053429#else
51991#define vduph_laneq_u16(__p0, __p1) __extension__ ({ \
51992 uint16_t __ret; \
51993 uint16x8_t __s0 = __p0; \
51994 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
51995 __ret = (uint16_t) __builtin_neon_vduph_laneq_i16((int16x8_t)__rev0, __p1); \
53430#define vqdmulh_lane_s32(__p0, __p1, __p2) __extension__ ({ \
53431 int32x2_t __ret; \
53432 int32x2_t __s0 = __p0; \
53433 int32x2_t __s1 = __p1; \
53434 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
53435 int32x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
53436 __ret = (int32x2_t) __builtin_neon_vqdmulh_lane_v((int8x8_t)__rev0, (int8x8_t)__rev1, __p2, 2); \
53437 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
5199653438 __ret; \
5199753439})
5199853440#endif
5199953441
5200053442#ifdef __LITTLE_ENDIAN__
52001#define vdupb_laneq_s8(__p0, __p1) __extension__ ({ \
52002 int8_t __ret; \
52003 int8x16_t __s0 = __p0; \
52004 __ret = (int8_t) __builtin_neon_vdupb_laneq_i8((int8x16_t)__s0, __p1); \
53443#define vqdmulh_lane_s16(__p0, __p1, __p2) __extension__ ({ \
53444 int16x4_t __ret; \
53445 int16x4_t __s0 = __p0; \
53446 int16x4_t __s1 = __p1; \
53447 __ret = (int16x4_t) __builtin_neon_vqdmulh_lane_v((int8x8_t)__s0, (int8x8_t)__s1, __p2, 1); \
5200553448 __ret; \
5200653449})
5200753450#else
52008#define vdupb_laneq_s8(__p0, __p1) __extension__ ({ \
52009 int8_t __ret; \
52010 int8x16_t __s0 = __p0; \
52011 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
52012 __ret = (int8_t) __builtin_neon_vdupb_laneq_i8((int8x16_t)__rev0, __p1); \
53451#define vqdmulh_lane_s16(__p0, __p1, __p2) __extension__ ({ \
53452 int16x4_t __ret; \
53453 int16x4_t __s0 = __p0; \
53454 int16x4_t __s1 = __p1; \
53455 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
53456 int16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
53457 __ret = (int16x4_t) __builtin_neon_vqdmulh_lane_v((int8x8_t)__rev0, (int8x8_t)__rev1, __p2, 1); \
53458 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
5201353459 __ret; \
5201453460})
5201553461#endif
5201653462
5201753463#ifdef __LITTLE_ENDIAN__
52018#define vdupd_laneq_f64(__p0, __p1) __extension__ ({ \
52019 float64_t __ret; \
52020 float64x2_t __s0 = __p0; \
52021 __ret = (float64_t) __builtin_neon_vdupd_laneq_f64((float64x2_t)__s0, __p1); \
52022 __ret; \
53464#define vqdmulhs_lane_s32(__p0_631, __p1_631, __p2_631) __extension__ ({ \
53465 int32_t __ret_631; \
53466 int32_t __s0_631 = __p0_631; \
53467 int32x2_t __s1_631 = __p1_631; \
53468 __ret_631 = vqdmulhs_s32(__s0_631, vget_lane_s32(__s1_631, __p2_631)); \
53469 __ret_631; \
53470})
53471#else
53472#define vqdmulhs_lane_s32(__p0_632, __p1_632, __p2_632) __extension__ ({ \
53473 int32_t __ret_632; \
53474 int32_t __s0_632 = __p0_632; \
53475 int32x2_t __s1_632 = __p1_632; \
53476 int32x2_t __rev1_632; __rev1_632 = __builtin_shufflevector(__s1_632, __s1_632, 1, 0); \
53477 __ret_632 = vqdmulhs_s32(__s0_632, __noswap_vget_lane_s32(__rev1_632, __p2_632)); \
53478 __ret_632; \
53479})
53480#endif
53481
53482#ifdef __LITTLE_ENDIAN__
53483#define vqdmulhh_lane_s16(__p0_633, __p1_633, __p2_633) __extension__ ({ \
53484 int16_t __ret_633; \
53485 int16_t __s0_633 = __p0_633; \
53486 int16x4_t __s1_633 = __p1_633; \
53487 __ret_633 = vqdmulhh_s16(__s0_633, vget_lane_s16(__s1_633, __p2_633)); \
53488 __ret_633; \
53489})
53490#else
53491#define vqdmulhh_lane_s16(__p0_634, __p1_634, __p2_634) __extension__ ({ \
53492 int16_t __ret_634; \
53493 int16_t __s0_634 = __p0_634; \
53494 int16x4_t __s1_634 = __p1_634; \
53495 int16x4_t __rev1_634; __rev1_634 = __builtin_shufflevector(__s1_634, __s1_634, 3, 2, 1, 0); \
53496 __ret_634 = vqdmulhh_s16(__s0_634, __noswap_vget_lane_s16(__rev1_634, __p2_634)); \
53497 __ret_634; \
53498})
53499#endif
53500
53501#ifdef __LITTLE_ENDIAN__
53502#define vqdmulhs_laneq_s32(__p0_635, __p1_635, __p2_635) __extension__ ({ \
53503 int32_t __ret_635; \
53504 int32_t __s0_635 = __p0_635; \
53505 int32x4_t __s1_635 = __p1_635; \
53506 __ret_635 = vqdmulhs_s32(__s0_635, vgetq_lane_s32(__s1_635, __p2_635)); \
53507 __ret_635; \
5202353508})
5202453509#else
52025#define vdupd_laneq_f64(__p0, __p1) __extension__ ({ \
52026 float64_t __ret; \
52027 float64x2_t __s0 = __p0; \
52028 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
52029 __ret = (float64_t) __builtin_neon_vdupd_laneq_f64((float64x2_t)__rev0, __p1); \
52030 __ret; \
53510#define vqdmulhs_laneq_s32(__p0_636, __p1_636, __p2_636) __extension__ ({ \
53511 int32_t __ret_636; \
53512 int32_t __s0_636 = __p0_636; \
53513 int32x4_t __s1_636 = __p1_636; \
53514 int32x4_t __rev1_636; __rev1_636 = __builtin_shufflevector(__s1_636, __s1_636, 3, 2, 1, 0); \
53515 __ret_636 = vqdmulhs_s32(__s0_636, __noswap_vgetq_lane_s32(__rev1_636, __p2_636)); \
53516 __ret_636; \
5203153517})
5203253518#endif
5203353519
5203453520#ifdef __LITTLE_ENDIAN__
52035#define vdups_laneq_f32(__p0, __p1) __extension__ ({ \
52036 float32_t __ret; \
52037 float32x4_t __s0 = __p0; \
52038 __ret = (float32_t) __builtin_neon_vdups_laneq_f32((float32x4_t)__s0, __p1); \
52039 __ret; \
53521#define vqdmulhh_laneq_s16(__p0_637, __p1_637, __p2_637) __extension__ ({ \
53522 int16_t __ret_637; \
53523 int16_t __s0_637 = __p0_637; \
53524 int16x8_t __s1_637 = __p1_637; \
53525 __ret_637 = vqdmulhh_s16(__s0_637, vgetq_lane_s16(__s1_637, __p2_637)); \
53526 __ret_637; \
5204053527})
5204153528#else
52042#define vdups_laneq_f32(__p0, __p1) __extension__ ({ \
52043 float32_t __ret; \
52044 float32x4_t __s0 = __p0; \
52045 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
52046 __ret = (float32_t) __builtin_neon_vdups_laneq_f32((float32x4_t)__rev0, __p1); \
52047 __ret; \
53529#define vqdmulhh_laneq_s16(__p0_638, __p1_638, __p2_638) __extension__ ({ \
53530 int16_t __ret_638; \
53531 int16_t __s0_638 = __p0_638; \
53532 int16x8_t __s1_638 = __p1_638; \
53533 int16x8_t __rev1_638; __rev1_638 = __builtin_shufflevector(__s1_638, __s1_638, 7, 6, 5, 4, 3, 2, 1, 0); \
53534 __ret_638 = vqdmulhh_s16(__s0_638, __noswap_vgetq_lane_s16(__rev1_638, __p2_638)); \
53535 __ret_638; \
5204853536})
5204953537#endif
5205053538
5205153539#ifdef __LITTLE_ENDIAN__
52052#define vdups_laneq_s32(__p0, __p1) __extension__ ({ \
52053 int32_t __ret; \
53540#define vqdmulhq_laneq_s32(__p0, __p1, __p2) __extension__ ({ \
53541 int32x4_t __ret; \
5205453542 int32x4_t __s0 = __p0; \
52055 __ret = (int32_t) __builtin_neon_vdups_laneq_i32((int32x4_t)__s0, __p1); \
53543 int32x4_t __s1 = __p1; \
53544 __ret = (int32x4_t) __builtin_neon_vqdmulhq_laneq_v((int8x16_t)__s0, (int8x16_t)__s1, __p2, 34); \
5205653545 __ret; \
5205753546})
5205853547#else
52059#define vdups_laneq_s32(__p0, __p1) __extension__ ({ \
52060 int32_t __ret; \
53548#define vqdmulhq_laneq_s32(__p0, __p1, __p2) __extension__ ({ \
53549 int32x4_t __ret; \
5206153550 int32x4_t __s0 = __p0; \
53551 int32x4_t __s1 = __p1; \
5206253552 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
52063 __ret = (int32_t) __builtin_neon_vdups_laneq_i32((int32x4_t)__rev0, __p1); \
53553 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
53554 __ret = (int32x4_t) __builtin_neon_vqdmulhq_laneq_v((int8x16_t)__rev0, (int8x16_t)__rev1, __p2, 34); \
53555 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
5206453556 __ret; \
5206553557})
5206653558#endif
5206753559
5206853560#ifdef __LITTLE_ENDIAN__
52069#define vdupd_laneq_s64(__p0, __p1) __extension__ ({ \
52070 int64_t __ret; \
52071 int64x2_t __s0 = __p0; \
52072 __ret = (int64_t) __builtin_neon_vdupd_laneq_i64((int64x2_t)__s0, __p1); \
53561#define vqdmulhq_laneq_s16(__p0, __p1, __p2) __extension__ ({ \
53562 int16x8_t __ret; \
53563 int16x8_t __s0 = __p0; \
53564 int16x8_t __s1 = __p1; \
53565 __ret = (int16x8_t) __builtin_neon_vqdmulhq_laneq_v((int8x16_t)__s0, (int8x16_t)__s1, __p2, 33); \
5207353566 __ret; \
5207453567})
5207553568#else
52076#define vdupd_laneq_s64(__p0, __p1) __extension__ ({ \
52077 int64_t __ret; \
52078 int64x2_t __s0 = __p0; \
52079 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
52080 __ret = (int64_t) __builtin_neon_vdupd_laneq_i64((int64x2_t)__rev0, __p1); \
53569#define vqdmulhq_laneq_s16(__p0, __p1, __p2) __extension__ ({ \
53570 int16x8_t __ret; \
53571 int16x8_t __s0 = __p0; \
53572 int16x8_t __s1 = __p1; \
53573 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
53574 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
53575 __ret = (int16x8_t) __builtin_neon_vqdmulhq_laneq_v((int8x16_t)__rev0, (int8x16_t)__rev1, __p2, 33); \
53576 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
5208153577 __ret; \
5208253578})
5208353579#endif
5208453580
5208553581#ifdef __LITTLE_ENDIAN__
52086#define vduph_laneq_s16(__p0, __p1) __extension__ ({ \
52087 int16_t __ret; \
52088 int16x8_t __s0 = __p0; \
52089 __ret = (int16_t) __builtin_neon_vduph_laneq_i16((int16x8_t)__s0, __p1); \
53582#define vqdmulh_laneq_s32(__p0, __p1, __p2) __extension__ ({ \
53583 int32x2_t __ret; \
53584 int32x2_t __s0 = __p0; \
53585 int32x4_t __s1 = __p1; \
53586 __ret = (int32x2_t) __builtin_neon_vqdmulh_laneq_v((int8x8_t)__s0, (int8x16_t)__s1, __p2, 2); \
5209053587 __ret; \
5209153588})
5209253589#else
52093#define vduph_laneq_s16(__p0, __p1) __extension__ ({ \
52094 int16_t __ret; \
52095 int16x8_t __s0 = __p0; \
52096 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
52097 __ret = (int16_t) __builtin_neon_vduph_laneq_i16((int16x8_t)__rev0, __p1); \
53590#define vqdmulh_laneq_s32(__p0, __p1, __p2) __extension__ ({ \
53591 int32x2_t __ret; \
53592 int32x2_t __s0 = __p0; \
53593 int32x4_t __s1 = __p1; \
53594 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
53595 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
53596 __ret = (int32x2_t) __builtin_neon_vqdmulh_laneq_v((int8x8_t)__rev0, (int8x16_t)__rev1, __p2, 2); \
53597 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
5209853598 __ret; \
5209953599})
5210053600#endif
5210153601
5210253602#ifdef __LITTLE_ENDIAN__
52103#define vdup_laneq_p8(__p0_453, __p1_453) __extension__ ({ \
52104 poly8x8_t __ret_453; \
52105 poly8x16_t __s0_453 = __p0_453; \
52106 __ret_453 = splat_laneq_p8(__s0_453, __p1_453); \
52107 __ret_453; \
53603#define vqdmulh_laneq_s16(__p0, __p1, __p2) __extension__ ({ \
53604 int16x4_t __ret; \
53605 int16x4_t __s0 = __p0; \
53606 int16x8_t __s1 = __p1; \
53607 __ret = (int16x4_t) __builtin_neon_vqdmulh_laneq_v((int8x8_t)__s0, (int8x16_t)__s1, __p2, 1); \
53608 __ret; \
5210853609})
5210953610#else
52110#define vdup_laneq_p8(__p0_454, __p1_454) __extension__ ({ \
52111 poly8x8_t __ret_454; \
52112 poly8x16_t __s0_454 = __p0_454; \
52113 poly8x16_t __rev0_454; __rev0_454 = __builtin_shufflevector(__s0_454, __s0_454, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
52114 __ret_454 = __noswap_splat_laneq_p8(__rev0_454, __p1_454); \
52115 __ret_454 = __builtin_shufflevector(__ret_454, __ret_454, 7, 6, 5, 4, 3, 2, 1, 0); \
52116 __ret_454; \
53611#define vqdmulh_laneq_s16(__p0, __p1, __p2) __extension__ ({ \
53612 int16x4_t __ret; \
53613 int16x4_t __s0 = __p0; \
53614 int16x8_t __s1 = __p1; \
53615 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
53616 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
53617 __ret = (int16x4_t) __builtin_neon_vqdmulh_laneq_v((int8x8_t)__rev0, (int8x16_t)__rev1, __p2, 1); \
53618 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
53619 __ret; \
5211753620})
5211853621#endif
5211953622
53623__ai int64_t vqdmulls_s32(int32_t __p0, int32_t __p1) {
53624 int64_t __ret;
53625 __ret = (int64_t) __builtin_neon_vqdmulls_s32(__p0, __p1);
53626 return __ret;
53627}
53628__ai int32_t vqdmullh_s16(int16_t __p0, int16_t __p1) {
53629 int32_t __ret;
53630 __ret = (int32_t) __builtin_neon_vqdmullh_s16(__p0, __p1);
53631 return __ret;
53632}
5212053633#ifdef __LITTLE_ENDIAN__
52121#define vdup_laneq_p64(__p0_455, __p1_455) __extension__ ({ \
52122 poly64x1_t __ret_455; \
52123 poly64x2_t __s0_455 = __p0_455; \
52124 __ret_455 = splat_laneq_p64(__s0_455, __p1_455); \
52125 __ret_455; \
52126})
53634__ai int64x2_t vqdmull_high_s32(int32x4_t __p0, int32x4_t __p1) {
53635 int64x2_t __ret;
53636 __ret = vqdmull_s32(vget_high_s32(__p0), vget_high_s32(__p1));
53637 return __ret;
53638}
5212753639#else
52128#define vdup_laneq_p64(__p0_456, __p1_456) __extension__ ({ \
52129 poly64x1_t __ret_456; \
52130 poly64x2_t __s0_456 = __p0_456; \
52131 poly64x2_t __rev0_456; __rev0_456 = __builtin_shufflevector(__s0_456, __s0_456, 1, 0); \
52132 __ret_456 = __noswap_splat_laneq_p64(__rev0_456, __p1_456); \
52133 __ret_456; \
52134})
53640__ai int64x2_t vqdmull_high_s32(int32x4_t __p0, int32x4_t __p1) {
53641 int64x2_t __ret;
53642 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
53643 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
53644 __ret = __noswap_vqdmull_s32(__noswap_vget_high_s32(__rev0), __noswap_vget_high_s32(__rev1));
53645 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
53646 return __ret;
53647}
5213553648#endif
5213653649
5213753650#ifdef __LITTLE_ENDIAN__
52138#define vdup_laneq_p16(__p0_457, __p1_457) __extension__ ({ \
52139 poly16x4_t __ret_457; \
52140 poly16x8_t __s0_457 = __p0_457; \
52141 __ret_457 = splat_laneq_p16(__s0_457, __p1_457); \
52142 __ret_457; \
52143})
53651__ai int32x4_t vqdmull_high_s16(int16x8_t __p0, int16x8_t __p1) {
53652 int32x4_t __ret;
53653 __ret = vqdmull_s16(vget_high_s16(__p0), vget_high_s16(__p1));
53654 return __ret;
53655}
5214453656#else
52145#define vdup_laneq_p16(__p0_458, __p1_458) __extension__ ({ \
52146 poly16x4_t __ret_458; \
52147 poly16x8_t __s0_458 = __p0_458; \
52148 poly16x8_t __rev0_458; __rev0_458 = __builtin_shufflevector(__s0_458, __s0_458, 7, 6, 5, 4, 3, 2, 1, 0); \
52149 __ret_458 = __noswap_splat_laneq_p16(__rev0_458, __p1_458); \
52150 __ret_458 = __builtin_shufflevector(__ret_458, __ret_458, 3, 2, 1, 0); \
52151 __ret_458; \
52152})
53657__ai int32x4_t vqdmull_high_s16(int16x8_t __p0, int16x8_t __p1) {
53658 int32x4_t __ret;
53659 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
53660 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
53661 __ret = __noswap_vqdmull_s16(__noswap_vget_high_s16(__rev0), __noswap_vget_high_s16(__rev1));
53662 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
53663 return __ret;
53664}
5215353665#endif
5215453666
5215553667#ifdef __LITTLE_ENDIAN__
52156#define vdupq_laneq_p8(__p0_459, __p1_459) __extension__ ({ \
52157 poly8x16_t __ret_459; \
52158 poly8x16_t __s0_459 = __p0_459; \
52159 __ret_459 = splatq_laneq_p8(__s0_459, __p1_459); \
52160 __ret_459; \
53668#define vqdmull_high_lane_s32(__p0_639, __p1_639, __p2_639) __extension__ ({ \
53669 int64x2_t __ret_639; \
53670 int32x4_t __s0_639 = __p0_639; \
53671 int32x2_t __s1_639 = __p1_639; \
53672 __ret_639 = vqdmull_s32(vget_high_s32(__s0_639), splat_lane_s32(__s1_639, __p2_639)); \
53673 __ret_639; \
5216153674})
5216253675#else
52163#define vdupq_laneq_p8(__p0_460, __p1_460) __extension__ ({ \
52164 poly8x16_t __ret_460; \
52165 poly8x16_t __s0_460 = __p0_460; \
52166 poly8x16_t __rev0_460; __rev0_460 = __builtin_shufflevector(__s0_460, __s0_460, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
52167 __ret_460 = __noswap_splatq_laneq_p8(__rev0_460, __p1_460); \
52168 __ret_460 = __builtin_shufflevector(__ret_460, __ret_460, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
52169 __ret_460; \
53676#define vqdmull_high_lane_s32(__p0_640, __p1_640, __p2_640) __extension__ ({ \
53677 int64x2_t __ret_640; \
53678 int32x4_t __s0_640 = __p0_640; \
53679 int32x2_t __s1_640 = __p1_640; \
53680 int32x4_t __rev0_640; __rev0_640 = __builtin_shufflevector(__s0_640, __s0_640, 3, 2, 1, 0); \
53681 int32x2_t __rev1_640; __rev1_640 = __builtin_shufflevector(__s1_640, __s1_640, 1, 0); \
53682 __ret_640 = __noswap_vqdmull_s32(__noswap_vget_high_s32(__rev0_640), __noswap_splat_lane_s32(__rev1_640, __p2_640)); \
53683 __ret_640 = __builtin_shufflevector(__ret_640, __ret_640, 1, 0); \
53684 __ret_640; \
5217053685})
5217153686#endif
5217253687
5217353688#ifdef __LITTLE_ENDIAN__
52174#define vdupq_laneq_p64(__p0_461, __p1_461) __extension__ ({ \
52175 poly64x2_t __ret_461; \
52176 poly64x2_t __s0_461 = __p0_461; \
52177 __ret_461 = splatq_laneq_p64(__s0_461, __p1_461); \
52178 __ret_461; \
53689#define vqdmull_high_lane_s16(__p0_641, __p1_641, __p2_641) __extension__ ({ \
53690 int32x4_t __ret_641; \
53691 int16x8_t __s0_641 = __p0_641; \
53692 int16x4_t __s1_641 = __p1_641; \
53693 __ret_641 = vqdmull_s16(vget_high_s16(__s0_641), splat_lane_s16(__s1_641, __p2_641)); \
53694 __ret_641; \
5217953695})
5218053696#else
52181#define vdupq_laneq_p64(__p0_462, __p1_462) __extension__ ({ \
52182 poly64x2_t __ret_462; \
52183 poly64x2_t __s0_462 = __p0_462; \
52184 poly64x2_t __rev0_462; __rev0_462 = __builtin_shufflevector(__s0_462, __s0_462, 1, 0); \
52185 __ret_462 = __noswap_splatq_laneq_p64(__rev0_462, __p1_462); \
52186 __ret_462 = __builtin_shufflevector(__ret_462, __ret_462, 1, 0); \
52187 __ret_462; \
53697#define vqdmull_high_lane_s16(__p0_642, __p1_642, __p2_642) __extension__ ({ \
53698 int32x4_t __ret_642; \
53699 int16x8_t __s0_642 = __p0_642; \
53700 int16x4_t __s1_642 = __p1_642; \
53701 int16x8_t __rev0_642; __rev0_642 = __builtin_shufflevector(__s0_642, __s0_642, 7, 6, 5, 4, 3, 2, 1, 0); \
53702 int16x4_t __rev1_642; __rev1_642 = __builtin_shufflevector(__s1_642, __s1_642, 3, 2, 1, 0); \
53703 __ret_642 = __noswap_vqdmull_s16(__noswap_vget_high_s16(__rev0_642), __noswap_splat_lane_s16(__rev1_642, __p2_642)); \
53704 __ret_642 = __builtin_shufflevector(__ret_642, __ret_642, 3, 2, 1, 0); \
53705 __ret_642; \
5218853706})
5218953707#endif
5219053708
5219153709#ifdef __LITTLE_ENDIAN__
52192#define vdupq_laneq_p16(__p0_463, __p1_463) __extension__ ({ \
52193 poly16x8_t __ret_463; \
52194 poly16x8_t __s0_463 = __p0_463; \
52195 __ret_463 = splatq_laneq_p16(__s0_463, __p1_463); \
52196 __ret_463; \
53710#define vqdmull_high_laneq_s32(__p0_643, __p1_643, __p2_643) __extension__ ({ \
53711 int64x2_t __ret_643; \
53712 int32x4_t __s0_643 = __p0_643; \
53713 int32x4_t __s1_643 = __p1_643; \
53714 __ret_643 = vqdmull_s32(vget_high_s32(__s0_643), splat_laneq_s32(__s1_643, __p2_643)); \
53715 __ret_643; \
5219753716})
5219853717#else
52199#define vdupq_laneq_p16(__p0_464, __p1_464) __extension__ ({ \
52200 poly16x8_t __ret_464; \
52201 poly16x8_t __s0_464 = __p0_464; \
52202 poly16x8_t __rev0_464; __rev0_464 = __builtin_shufflevector(__s0_464, __s0_464, 7, 6, 5, 4, 3, 2, 1, 0); \
52203 __ret_464 = __noswap_splatq_laneq_p16(__rev0_464, __p1_464); \
52204 __ret_464 = __builtin_shufflevector(__ret_464, __ret_464, 7, 6, 5, 4, 3, 2, 1, 0); \
52205 __ret_464; \
53718#define vqdmull_high_laneq_s32(__p0_644, __p1_644, __p2_644) __extension__ ({ \
53719 int64x2_t __ret_644; \
53720 int32x4_t __s0_644 = __p0_644; \
53721 int32x4_t __s1_644 = __p1_644; \
53722 int32x4_t __rev0_644; __rev0_644 = __builtin_shufflevector(__s0_644, __s0_644, 3, 2, 1, 0); \
53723 int32x4_t __rev1_644; __rev1_644 = __builtin_shufflevector(__s1_644, __s1_644, 3, 2, 1, 0); \
53724 __ret_644 = __noswap_vqdmull_s32(__noswap_vget_high_s32(__rev0_644), __noswap_splat_laneq_s32(__rev1_644, __p2_644)); \
53725 __ret_644 = __builtin_shufflevector(__ret_644, __ret_644, 1, 0); \
53726 __ret_644; \
5220653727})
5220753728#endif
5220853729
5220953730#ifdef __LITTLE_ENDIAN__
52210#define vdupq_laneq_u8(__p0_465, __p1_465) __extension__ ({ \
52211 uint8x16_t __ret_465; \
52212 uint8x16_t __s0_465 = __p0_465; \
52213 __ret_465 = splatq_laneq_u8(__s0_465, __p1_465); \
52214 __ret_465; \
53731#define vqdmull_high_laneq_s16(__p0_645, __p1_645, __p2_645) __extension__ ({ \
53732 int32x4_t __ret_645; \
53733 int16x8_t __s0_645 = __p0_645; \
53734 int16x8_t __s1_645 = __p1_645; \
53735 __ret_645 = vqdmull_s16(vget_high_s16(__s0_645), splat_laneq_s16(__s1_645, __p2_645)); \
53736 __ret_645; \
5221553737})
5221653738#else
52217#define vdupq_laneq_u8(__p0_466, __p1_466) __extension__ ({ \
52218 uint8x16_t __ret_466; \
52219 uint8x16_t __s0_466 = __p0_466; \
52220 uint8x16_t __rev0_466; __rev0_466 = __builtin_shufflevector(__s0_466, __s0_466, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
52221 __ret_466 = __noswap_splatq_laneq_u8(__rev0_466, __p1_466); \
52222 __ret_466 = __builtin_shufflevector(__ret_466, __ret_466, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
52223 __ret_466; \
53739#define vqdmull_high_laneq_s16(__p0_646, __p1_646, __p2_646) __extension__ ({ \
53740 int32x4_t __ret_646; \
53741 int16x8_t __s0_646 = __p0_646; \
53742 int16x8_t __s1_646 = __p1_646; \
53743 int16x8_t __rev0_646; __rev0_646 = __builtin_shufflevector(__s0_646, __s0_646, 7, 6, 5, 4, 3, 2, 1, 0); \
53744 int16x8_t __rev1_646; __rev1_646 = __builtin_shufflevector(__s1_646, __s1_646, 7, 6, 5, 4, 3, 2, 1, 0); \
53745 __ret_646 = __noswap_vqdmull_s16(__noswap_vget_high_s16(__rev0_646), __noswap_splat_laneq_s16(__rev1_646, __p2_646)); \
53746 __ret_646 = __builtin_shufflevector(__ret_646, __ret_646, 3, 2, 1, 0); \
53747 __ret_646; \
5222453748})
5222553749#endif
5222653750
5222753751#ifdef __LITTLE_ENDIAN__
52228#define vdupq_laneq_u32(__p0_467, __p1_467) __extension__ ({ \
52229 uint32x4_t __ret_467; \
52230 uint32x4_t __s0_467 = __p0_467; \
52231 __ret_467 = splatq_laneq_u32(__s0_467, __p1_467); \
52232 __ret_467; \
52233})
53752__ai int64x2_t vqdmull_high_n_s32(int32x4_t __p0, int32_t __p1) {
53753 int64x2_t __ret;
53754 __ret = vqdmull_n_s32(vget_high_s32(__p0), __p1);
53755 return __ret;
53756}
5223453757#else
52235#define vdupq_laneq_u32(__p0_468, __p1_468) __extension__ ({ \
52236 uint32x4_t __ret_468; \
52237 uint32x4_t __s0_468 = __p0_468; \
52238 uint32x4_t __rev0_468; __rev0_468 = __builtin_shufflevector(__s0_468, __s0_468, 3, 2, 1, 0); \
52239 __ret_468 = __noswap_splatq_laneq_u32(__rev0_468, __p1_468); \
52240 __ret_468 = __builtin_shufflevector(__ret_468, __ret_468, 3, 2, 1, 0); \
52241 __ret_468; \
52242})
53758__ai int64x2_t vqdmull_high_n_s32(int32x4_t __p0, int32_t __p1) {
53759 int64x2_t __ret;
53760 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
53761 __ret = __noswap_vqdmull_n_s32(__noswap_vget_high_s32(__rev0), __p1);
53762 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
53763 return __ret;
53764}
5224353765#endif
5224453766
5224553767#ifdef __LITTLE_ENDIAN__
52246#define vdupq_laneq_u64(__p0_469, __p1_469) __extension__ ({ \
52247 uint64x2_t __ret_469; \
52248 uint64x2_t __s0_469 = __p0_469; \
52249 __ret_469 = splatq_laneq_u64(__s0_469, __p1_469); \
52250 __ret_469; \
52251})
53768__ai int32x4_t vqdmull_high_n_s16(int16x8_t __p0, int16_t __p1) {
53769 int32x4_t __ret;
53770 __ret = vqdmull_n_s16(vget_high_s16(__p0), __p1);
53771 return __ret;
53772}
5225253773#else
52253#define vdupq_laneq_u64(__p0_470, __p1_470) __extension__ ({ \
52254 uint64x2_t __ret_470; \
52255 uint64x2_t __s0_470 = __p0_470; \
52256 uint64x2_t __rev0_470; __rev0_470 = __builtin_shufflevector(__s0_470, __s0_470, 1, 0); \
52257 __ret_470 = __noswap_splatq_laneq_u64(__rev0_470, __p1_470); \
52258 __ret_470 = __builtin_shufflevector(__ret_470, __ret_470, 1, 0); \
52259 __ret_470; \
52260})
53774__ai int32x4_t vqdmull_high_n_s16(int16x8_t __p0, int16_t __p1) {
53775 int32x4_t __ret;
53776 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
53777 __ret = __noswap_vqdmull_n_s16(__noswap_vget_high_s16(__rev0), __p1);
53778 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
53779 return __ret;
53780}
5226153781#endif
5226253782
5226353783#ifdef __LITTLE_ENDIAN__
52264#define vdupq_laneq_u16(__p0_471, __p1_471) __extension__ ({ \
52265 uint16x8_t __ret_471; \
52266 uint16x8_t __s0_471 = __p0_471; \
52267 __ret_471 = splatq_laneq_u16(__s0_471, __p1_471); \
52268 __ret_471; \
53784#define vqdmulls_lane_s32(__p0_647, __p1_647, __p2_647) __extension__ ({ \
53785 int64_t __ret_647; \
53786 int32_t __s0_647 = __p0_647; \
53787 int32x2_t __s1_647 = __p1_647; \
53788 __ret_647 = vqdmulls_s32(__s0_647, vget_lane_s32(__s1_647, __p2_647)); \
53789 __ret_647; \
5226953790})
5227053791#else
52271#define vdupq_laneq_u16(__p0_472, __p1_472) __extension__ ({ \
52272 uint16x8_t __ret_472; \
52273 uint16x8_t __s0_472 = __p0_472; \
52274 uint16x8_t __rev0_472; __rev0_472 = __builtin_shufflevector(__s0_472, __s0_472, 7, 6, 5, 4, 3, 2, 1, 0); \
52275 __ret_472 = __noswap_splatq_laneq_u16(__rev0_472, __p1_472); \
52276 __ret_472 = __builtin_shufflevector(__ret_472, __ret_472, 7, 6, 5, 4, 3, 2, 1, 0); \
52277 __ret_472; \
53792#define vqdmulls_lane_s32(__p0_648, __p1_648, __p2_648) __extension__ ({ \
53793 int64_t __ret_648; \
53794 int32_t __s0_648 = __p0_648; \
53795 int32x2_t __s1_648 = __p1_648; \
53796 int32x2_t __rev1_648; __rev1_648 = __builtin_shufflevector(__s1_648, __s1_648, 1, 0); \
53797 __ret_648 = vqdmulls_s32(__s0_648, __noswap_vget_lane_s32(__rev1_648, __p2_648)); \
53798 __ret_648; \
5227853799})
5227953800#endif
5228053801
5228153802#ifdef __LITTLE_ENDIAN__
52282#define vdupq_laneq_s8(__p0_473, __p1_473) __extension__ ({ \
52283 int8x16_t __ret_473; \
52284 int8x16_t __s0_473 = __p0_473; \
52285 __ret_473 = splatq_laneq_s8(__s0_473, __p1_473); \
52286 __ret_473; \
53803#define vqdmullh_lane_s16(__p0_649, __p1_649, __p2_649) __extension__ ({ \
53804 int32_t __ret_649; \
53805 int16_t __s0_649 = __p0_649; \
53806 int16x4_t __s1_649 = __p1_649; \
53807 __ret_649 = vqdmullh_s16(__s0_649, vget_lane_s16(__s1_649, __p2_649)); \
53808 __ret_649; \
5228753809})
5228853810#else
52289#define vdupq_laneq_s8(__p0_474, __p1_474) __extension__ ({ \
52290 int8x16_t __ret_474; \
52291 int8x16_t __s0_474 = __p0_474; \
52292 int8x16_t __rev0_474; __rev0_474 = __builtin_shufflevector(__s0_474, __s0_474, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
52293 __ret_474 = __noswap_splatq_laneq_s8(__rev0_474, __p1_474); \
52294 __ret_474 = __builtin_shufflevector(__ret_474, __ret_474, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
52295 __ret_474; \
53811#define vqdmullh_lane_s16(__p0_650, __p1_650, __p2_650) __extension__ ({ \
53812 int32_t __ret_650; \
53813 int16_t __s0_650 = __p0_650; \
53814 int16x4_t __s1_650 = __p1_650; \
53815 int16x4_t __rev1_650; __rev1_650 = __builtin_shufflevector(__s1_650, __s1_650, 3, 2, 1, 0); \
53816 __ret_650 = vqdmullh_s16(__s0_650, __noswap_vget_lane_s16(__rev1_650, __p2_650)); \
53817 __ret_650; \
5229653818})
5229753819#endif
5229853820
5229953821#ifdef __LITTLE_ENDIAN__
52300#define vdupq_laneq_f64(__p0_475, __p1_475) __extension__ ({ \
52301 float64x2_t __ret_475; \
52302 float64x2_t __s0_475 = __p0_475; \
52303 __ret_475 = splatq_laneq_f64(__s0_475, __p1_475); \
52304 __ret_475; \
53822#define vqdmulls_laneq_s32(__p0_651, __p1_651, __p2_651) __extension__ ({ \
53823 int64_t __ret_651; \
53824 int32_t __s0_651 = __p0_651; \
53825 int32x4_t __s1_651 = __p1_651; \
53826 __ret_651 = vqdmulls_s32(__s0_651, vgetq_lane_s32(__s1_651, __p2_651)); \
53827 __ret_651; \
5230553828})
5230653829#else
52307#define vdupq_laneq_f64(__p0_476, __p1_476) __extension__ ({ \
52308 float64x2_t __ret_476; \
52309 float64x2_t __s0_476 = __p0_476; \
52310 float64x2_t __rev0_476; __rev0_476 = __builtin_shufflevector(__s0_476, __s0_476, 1, 0); \
52311 __ret_476 = __noswap_splatq_laneq_f64(__rev0_476, __p1_476); \
52312 __ret_476 = __builtin_shufflevector(__ret_476, __ret_476, 1, 0); \
52313 __ret_476; \
53830#define vqdmulls_laneq_s32(__p0_652, __p1_652, __p2_652) __extension__ ({ \
53831 int64_t __ret_652; \
53832 int32_t __s0_652 = __p0_652; \
53833 int32x4_t __s1_652 = __p1_652; \
53834 int32x4_t __rev1_652; __rev1_652 = __builtin_shufflevector(__s1_652, __s1_652, 3, 2, 1, 0); \
53835 __ret_652 = vqdmulls_s32(__s0_652, __noswap_vgetq_lane_s32(__rev1_652, __p2_652)); \
53836 __ret_652; \
5231453837})
5231553838#endif
5231653839
5231753840#ifdef __LITTLE_ENDIAN__
52318#define vdupq_laneq_f32(__p0_477, __p1_477) __extension__ ({ \
52319 float32x4_t __ret_477; \
52320 float32x4_t __s0_477 = __p0_477; \
52321 __ret_477 = splatq_laneq_f32(__s0_477, __p1_477); \
52322 __ret_477; \
53841#define vqdmullh_laneq_s16(__p0_653, __p1_653, __p2_653) __extension__ ({ \
53842 int32_t __ret_653; \
53843 int16_t __s0_653 = __p0_653; \
53844 int16x8_t __s1_653 = __p1_653; \
53845 __ret_653 = vqdmullh_s16(__s0_653, vgetq_lane_s16(__s1_653, __p2_653)); \
53846 __ret_653; \
5232353847})
5232453848#else
52325#define vdupq_laneq_f32(__p0_478, __p1_478) __extension__ ({ \
52326 float32x4_t __ret_478; \
52327 float32x4_t __s0_478 = __p0_478; \
52328 float32x4_t __rev0_478; __rev0_478 = __builtin_shufflevector(__s0_478, __s0_478, 3, 2, 1, 0); \
52329 __ret_478 = __noswap_splatq_laneq_f32(__rev0_478, __p1_478); \
52330 __ret_478 = __builtin_shufflevector(__ret_478, __ret_478, 3, 2, 1, 0); \
52331 __ret_478; \
53849#define vqdmullh_laneq_s16(__p0_654, __p1_654, __p2_654) __extension__ ({ \
53850 int32_t __ret_654; \
53851 int16_t __s0_654 = __p0_654; \
53852 int16x8_t __s1_654 = __p1_654; \
53853 int16x8_t __rev1_654; __rev1_654 = __builtin_shufflevector(__s1_654, __s1_654, 7, 6, 5, 4, 3, 2, 1, 0); \
53854 __ret_654 = vqdmullh_s16(__s0_654, __noswap_vgetq_lane_s16(__rev1_654, __p2_654)); \
53855 __ret_654; \
5233253856})
5233353857#endif
5233453858
5233553859#ifdef __LITTLE_ENDIAN__
52336#define vdupq_laneq_f16(__p0_479, __p1_479) __extension__ ({ \
52337 float16x8_t __ret_479; \
52338 float16x8_t __s0_479 = __p0_479; \
52339 __ret_479 = splatq_laneq_f16(__s0_479, __p1_479); \
52340 __ret_479; \
53860#define vqdmull_laneq_s32(__p0_655, __p1_655, __p2_655) __extension__ ({ \
53861 int64x2_t __ret_655; \
53862 int32x2_t __s0_655 = __p0_655; \
53863 int32x4_t __s1_655 = __p1_655; \
53864 __ret_655 = vqdmull_s32(__s0_655, splat_laneq_s32(__s1_655, __p2_655)); \
53865 __ret_655; \
5234153866})
5234253867#else
52343#define vdupq_laneq_f16(__p0_480, __p1_480) __extension__ ({ \
52344 float16x8_t __ret_480; \
52345 float16x8_t __s0_480 = __p0_480; \
52346 float16x8_t __rev0_480; __rev0_480 = __builtin_shufflevector(__s0_480, __s0_480, 7, 6, 5, 4, 3, 2, 1, 0); \
52347 __ret_480 = __noswap_splatq_laneq_f16(__rev0_480, __p1_480); \
52348 __ret_480 = __builtin_shufflevector(__ret_480, __ret_480, 7, 6, 5, 4, 3, 2, 1, 0); \
52349 __ret_480; \
53868#define vqdmull_laneq_s32(__p0_656, __p1_656, __p2_656) __extension__ ({ \
53869 int64x2_t __ret_656; \
53870 int32x2_t __s0_656 = __p0_656; \
53871 int32x4_t __s1_656 = __p1_656; \
53872 int32x2_t __rev0_656; __rev0_656 = __builtin_shufflevector(__s0_656, __s0_656, 1, 0); \
53873 int32x4_t __rev1_656; __rev1_656 = __builtin_shufflevector(__s1_656, __s1_656, 3, 2, 1, 0); \
53874 __ret_656 = __noswap_vqdmull_s32(__rev0_656, __noswap_splat_laneq_s32(__rev1_656, __p2_656)); \
53875 __ret_656 = __builtin_shufflevector(__ret_656, __ret_656, 1, 0); \
53876 __ret_656; \
5235053877})
5235153878#endif
5235253879
5235353880#ifdef __LITTLE_ENDIAN__
52354#define vdupq_laneq_s32(__p0_481, __p1_481) __extension__ ({ \
52355 int32x4_t __ret_481; \
52356 int32x4_t __s0_481 = __p0_481; \
52357 __ret_481 = splatq_laneq_s32(__s0_481, __p1_481); \
52358 __ret_481; \
53881#define vqdmull_laneq_s16(__p0_657, __p1_657, __p2_657) __extension__ ({ \
53882 int32x4_t __ret_657; \
53883 int16x4_t __s0_657 = __p0_657; \
53884 int16x8_t __s1_657 = __p1_657; \
53885 __ret_657 = vqdmull_s16(__s0_657, splat_laneq_s16(__s1_657, __p2_657)); \
53886 __ret_657; \
5235953887})
5236053888#else
52361#define vdupq_laneq_s32(__p0_482, __p1_482) __extension__ ({ \
52362 int32x4_t __ret_482; \
52363 int32x4_t __s0_482 = __p0_482; \
52364 int32x4_t __rev0_482; __rev0_482 = __builtin_shufflevector(__s0_482, __s0_482, 3, 2, 1, 0); \
52365 __ret_482 = __noswap_splatq_laneq_s32(__rev0_482, __p1_482); \
52366 __ret_482 = __builtin_shufflevector(__ret_482, __ret_482, 3, 2, 1, 0); \
52367 __ret_482; \
53889#define vqdmull_laneq_s16(__p0_658, __p1_658, __p2_658) __extension__ ({ \
53890 int32x4_t __ret_658; \
53891 int16x4_t __s0_658 = __p0_658; \
53892 int16x8_t __s1_658 = __p1_658; \
53893 int16x4_t __rev0_658; __rev0_658 = __builtin_shufflevector(__s0_658, __s0_658, 3, 2, 1, 0); \
53894 int16x8_t __rev1_658; __rev1_658 = __builtin_shufflevector(__s1_658, __s1_658, 7, 6, 5, 4, 3, 2, 1, 0); \
53895 __ret_658 = __noswap_vqdmull_s16(__rev0_658, __noswap_splat_laneq_s16(__rev1_658, __p2_658)); \
53896 __ret_658 = __builtin_shufflevector(__ret_658, __ret_658, 3, 2, 1, 0); \
53897 __ret_658; \
5236853898})
5236953899#endif
5237053900
53901__ai int16_t vqmovns_s32(int32_t __p0) {
53902 int16_t __ret;
53903 __ret = (int16_t) __builtin_neon_vqmovns_s32(__p0);
53904 return __ret;
53905}
53906__ai int32_t vqmovnd_s64(int64_t __p0) {
53907 int32_t __ret;
53908 __ret = (int32_t) __builtin_neon_vqmovnd_s64(__p0);
53909 return __ret;
53910}
53911__ai int8_t vqmovnh_s16(int16_t __p0) {
53912 int8_t __ret;
53913 __ret = (int8_t) __builtin_neon_vqmovnh_s16(__p0);
53914 return __ret;
53915}
53916__ai uint16_t vqmovns_u32(uint32_t __p0) {
53917 uint16_t __ret;
53918 __ret = (uint16_t) __builtin_neon_vqmovns_u32(__p0);
53919 return __ret;
53920}
53921__ai uint32_t vqmovnd_u64(uint64_t __p0) {
53922 uint32_t __ret;
53923 __ret = (uint32_t) __builtin_neon_vqmovnd_u64(__p0);
53924 return __ret;
53925}
53926__ai uint8_t vqmovnh_u16(uint16_t __p0) {
53927 uint8_t __ret;
53928 __ret = (uint8_t) __builtin_neon_vqmovnh_u16(__p0);
53929 return __ret;
53930}
5237153931#ifdef __LITTLE_ENDIAN__
52372#define vdupq_laneq_s64(__p0_483, __p1_483) __extension__ ({ \
52373 int64x2_t __ret_483; \
52374 int64x2_t __s0_483 = __p0_483; \
52375 __ret_483 = splatq_laneq_s64(__s0_483, __p1_483); \
52376 __ret_483; \
52377})
53932__ai uint16x8_t vqmovn_high_u32(uint16x4_t __p0, uint32x4_t __p1) {
53933 uint16x8_t __ret;
53934 __ret = vcombine_u16(__p0, vqmovn_u32(__p1));
53935 return __ret;
53936}
5237853937#else
52379#define vdupq_laneq_s64(__p0_484, __p1_484) __extension__ ({ \
52380 int64x2_t __ret_484; \
52381 int64x2_t __s0_484 = __p0_484; \
52382 int64x2_t __rev0_484; __rev0_484 = __builtin_shufflevector(__s0_484, __s0_484, 1, 0); \
52383 __ret_484 = __noswap_splatq_laneq_s64(__rev0_484, __p1_484); \
52384 __ret_484 = __builtin_shufflevector(__ret_484, __ret_484, 1, 0); \
52385 __ret_484; \
52386})
53938__ai uint16x8_t vqmovn_high_u32(uint16x4_t __p0, uint32x4_t __p1) {
53939 uint16x8_t __ret;
53940 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
53941 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
53942 __ret = __noswap_vcombine_u16(__rev0, __noswap_vqmovn_u32(__rev1));
53943 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
53944 return __ret;
53945}
5238753946#endif
5238853947
5238953948#ifdef __LITTLE_ENDIAN__
52390#define vdupq_laneq_s16(__p0_485, __p1_485) __extension__ ({ \
52391 int16x8_t __ret_485; \
52392 int16x8_t __s0_485 = __p0_485; \
52393 __ret_485 = splatq_laneq_s16(__s0_485, __p1_485); \
52394 __ret_485; \
52395})
53949__ai uint32x4_t vqmovn_high_u64(uint32x2_t __p0, uint64x2_t __p1) {
53950 uint32x4_t __ret;
53951 __ret = vcombine_u32(__p0, vqmovn_u64(__p1));
53952 return __ret;
53953}
5239653954#else
52397#define vdupq_laneq_s16(__p0_486, __p1_486) __extension__ ({ \
52398 int16x8_t __ret_486; \
52399 int16x8_t __s0_486 = __p0_486; \
52400 int16x8_t __rev0_486; __rev0_486 = __builtin_shufflevector(__s0_486, __s0_486, 7, 6, 5, 4, 3, 2, 1, 0); \
52401 __ret_486 = __noswap_splatq_laneq_s16(__rev0_486, __p1_486); \
52402 __ret_486 = __builtin_shufflevector(__ret_486, __ret_486, 7, 6, 5, 4, 3, 2, 1, 0); \
52403 __ret_486; \
52404})
53955__ai uint32x4_t vqmovn_high_u64(uint32x2_t __p0, uint64x2_t __p1) {
53956 uint32x4_t __ret;
53957 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
53958 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
53959 __ret = __noswap_vcombine_u32(__rev0, __noswap_vqmovn_u64(__rev1));
53960 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
53961 return __ret;
53962}
5240553963#endif
5240653964
5240753965#ifdef __LITTLE_ENDIAN__
52408#define vdup_laneq_u8(__p0_487, __p1_487) __extension__ ({ \
52409 uint8x8_t __ret_487; \
52410 uint8x16_t __s0_487 = __p0_487; \
52411 __ret_487 = splat_laneq_u8(__s0_487, __p1_487); \
52412 __ret_487; \
52413})
53966__ai uint8x16_t vqmovn_high_u16(uint8x8_t __p0, uint16x8_t __p1) {
53967 uint8x16_t __ret;
53968 __ret = vcombine_u8(__p0, vqmovn_u16(__p1));
53969 return __ret;
53970}
5241453971#else
52415#define vdup_laneq_u8(__p0_488, __p1_488) __extension__ ({ \
52416 uint8x8_t __ret_488; \
52417 uint8x16_t __s0_488 = __p0_488; \
52418 uint8x16_t __rev0_488; __rev0_488 = __builtin_shufflevector(__s0_488, __s0_488, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
52419 __ret_488 = __noswap_splat_laneq_u8(__rev0_488, __p1_488); \
52420 __ret_488 = __builtin_shufflevector(__ret_488, __ret_488, 7, 6, 5, 4, 3, 2, 1, 0); \
52421 __ret_488; \
52422})
53972__ai uint8x16_t vqmovn_high_u16(uint8x8_t __p0, uint16x8_t __p1) {
53973 uint8x16_t __ret;
53974 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
53975 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
53976 __ret = __noswap_vcombine_u8(__rev0, __noswap_vqmovn_u16(__rev1));
53977 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
53978 return __ret;
53979}
5242353980#endif
5242453981
5242553982#ifdef __LITTLE_ENDIAN__
52426#define vdup_laneq_u32(__p0_489, __p1_489) __extension__ ({ \
52427 uint32x2_t __ret_489; \
52428 uint32x4_t __s0_489 = __p0_489; \
52429 __ret_489 = splat_laneq_u32(__s0_489, __p1_489); \
52430 __ret_489; \
52431})
53983__ai int16x8_t vqmovn_high_s32(int16x4_t __p0, int32x4_t __p1) {
53984 int16x8_t __ret;
53985 __ret = vcombine_s16(__p0, vqmovn_s32(__p1));
53986 return __ret;
53987}
5243253988#else
52433#define vdup_laneq_u32(__p0_490, __p1_490) __extension__ ({ \
52434 uint32x2_t __ret_490; \
52435 uint32x4_t __s0_490 = __p0_490; \
52436 uint32x4_t __rev0_490; __rev0_490 = __builtin_shufflevector(__s0_490, __s0_490, 3, 2, 1, 0); \
52437 __ret_490 = __noswap_splat_laneq_u32(__rev0_490, __p1_490); \
52438 __ret_490 = __builtin_shufflevector(__ret_490, __ret_490, 1, 0); \
52439 __ret_490; \
52440})
53989__ai int16x8_t vqmovn_high_s32(int16x4_t __p0, int32x4_t __p1) {
53990 int16x8_t __ret;
53991 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
53992 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
53993 __ret = __noswap_vcombine_s16(__rev0, __noswap_vqmovn_s32(__rev1));
53994 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
53995 return __ret;
53996}
5244153997#endif
5244253998
5244353999#ifdef __LITTLE_ENDIAN__
52444#define vdup_laneq_u64(__p0_491, __p1_491) __extension__ ({ \
52445 uint64x1_t __ret_491; \
52446 uint64x2_t __s0_491 = __p0_491; \
52447 __ret_491 = splat_laneq_u64(__s0_491, __p1_491); \
52448 __ret_491; \
52449})
54000__ai int32x4_t vqmovn_high_s64(int32x2_t __p0, int64x2_t __p1) {
54001 int32x4_t __ret;
54002 __ret = vcombine_s32(__p0, vqmovn_s64(__p1));
54003 return __ret;
54004}
5245054005#else
52451#define vdup_laneq_u64(__p0_492, __p1_492) __extension__ ({ \
52452 uint64x1_t __ret_492; \
52453 uint64x2_t __s0_492 = __p0_492; \
52454 uint64x2_t __rev0_492; __rev0_492 = __builtin_shufflevector(__s0_492, __s0_492, 1, 0); \
52455 __ret_492 = __noswap_splat_laneq_u64(__rev0_492, __p1_492); \
52456 __ret_492; \
52457})
54006__ai int32x4_t vqmovn_high_s64(int32x2_t __p0, int64x2_t __p1) {
54007 int32x4_t __ret;
54008 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
54009 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
54010 __ret = __noswap_vcombine_s32(__rev0, __noswap_vqmovn_s64(__rev1));
54011 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
54012 return __ret;
54013}
5245854014#endif
5245954015
5246054016#ifdef __LITTLE_ENDIAN__
52461#define vdup_laneq_u16(__p0_493, __p1_493) __extension__ ({ \
52462 uint16x4_t __ret_493; \
52463 uint16x8_t __s0_493 = __p0_493; \
52464 __ret_493 = splat_laneq_u16(__s0_493, __p1_493); \
52465 __ret_493; \
54017__ai int8x16_t vqmovn_high_s16(int8x8_t __p0, int16x8_t __p1) {
54018 int8x16_t __ret;
54019 __ret = vcombine_s8(__p0, vqmovn_s16(__p1));
54020 return __ret;
54021}
54022#else
54023__ai int8x16_t vqmovn_high_s16(int8x8_t __p0, int16x8_t __p1) {
54024 int8x16_t __ret;
54025 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
54026 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
54027 __ret = __noswap_vcombine_s8(__rev0, __noswap_vqmovn_s16(__rev1));
54028 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
54029 return __ret;
54030}
54031#endif
54032
54033__ai uint16_t vqmovuns_s32(int32_t __p0) {
54034 uint16_t __ret;
54035 __ret = (uint16_t) __builtin_neon_vqmovuns_s32(__p0);
54036 return __ret;
54037}
54038__ai uint32_t vqmovund_s64(int64_t __p0) {
54039 uint32_t __ret;
54040 __ret = (uint32_t) __builtin_neon_vqmovund_s64(__p0);
54041 return __ret;
54042}
54043__ai uint8_t vqmovunh_s16(int16_t __p0) {
54044 uint8_t __ret;
54045 __ret = (uint8_t) __builtin_neon_vqmovunh_s16(__p0);
54046 return __ret;
54047}
54048#ifdef __LITTLE_ENDIAN__
54049__ai uint16x8_t vqmovun_high_s32(uint16x4_t __p0, int32x4_t __p1) {
54050 uint16x8_t __ret;
54051 __ret = vcombine_u16((uint16x4_t)(__p0), vqmovun_s32(__p1));
54052 return __ret;
54053}
54054#else
54055__ai uint16x8_t vqmovun_high_s32(uint16x4_t __p0, int32x4_t __p1) {
54056 uint16x8_t __ret;
54057 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
54058 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
54059 __ret = __noswap_vcombine_u16((uint16x4_t)(__rev0), __noswap_vqmovun_s32(__rev1));
54060 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
54061 return __ret;
54062}
54063#endif
54064
54065#ifdef __LITTLE_ENDIAN__
54066__ai uint32x4_t vqmovun_high_s64(uint32x2_t __p0, int64x2_t __p1) {
54067 uint32x4_t __ret;
54068 __ret = vcombine_u32((uint32x2_t)(__p0), vqmovun_s64(__p1));
54069 return __ret;
54070}
54071#else
54072__ai uint32x4_t vqmovun_high_s64(uint32x2_t __p0, int64x2_t __p1) {
54073 uint32x4_t __ret;
54074 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
54075 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
54076 __ret = __noswap_vcombine_u32((uint32x2_t)(__rev0), __noswap_vqmovun_s64(__rev1));
54077 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
54078 return __ret;
54079}
54080#endif
54081
54082#ifdef __LITTLE_ENDIAN__
54083__ai uint8x16_t vqmovun_high_s16(uint8x8_t __p0, int16x8_t __p1) {
54084 uint8x16_t __ret;
54085 __ret = vcombine_u8((uint8x8_t)(__p0), vqmovun_s16(__p1));
54086 return __ret;
54087}
54088#else
54089__ai uint8x16_t vqmovun_high_s16(uint8x8_t __p0, int16x8_t __p1) {
54090 uint8x16_t __ret;
54091 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
54092 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
54093 __ret = __noswap_vcombine_u8((uint8x8_t)(__rev0), __noswap_vqmovun_s16(__rev1));
54094 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
54095 return __ret;
54096}
54097#endif
54098
54099#ifdef __LITTLE_ENDIAN__
54100__ai int64x2_t vqnegq_s64(int64x2_t __p0) {
54101 int64x2_t __ret;
54102 __ret = (int64x2_t) __builtin_neon_vqnegq_v((int8x16_t)__p0, 35);
54103 return __ret;
54104}
54105#else
54106__ai int64x2_t vqnegq_s64(int64x2_t __p0) {
54107 int64x2_t __ret;
54108 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
54109 __ret = (int64x2_t) __builtin_neon_vqnegq_v((int8x16_t)__rev0, 35);
54110 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
54111 return __ret;
54112}
54113#endif
54114
54115__ai int64x1_t vqneg_s64(int64x1_t __p0) {
54116 int64x1_t __ret;
54117 __ret = (int64x1_t) __builtin_neon_vqneg_v((int8x8_t)__p0, 3);
54118 return __ret;
54119}
54120__ai int8_t vqnegb_s8(int8_t __p0) {
54121 int8_t __ret;
54122 __ret = (int8_t) __builtin_neon_vqnegb_s8(__p0);
54123 return __ret;
54124}
54125__ai int32_t vqnegs_s32(int32_t __p0) {
54126 int32_t __ret;
54127 __ret = (int32_t) __builtin_neon_vqnegs_s32(__p0);
54128 return __ret;
54129}
54130__ai int64_t vqnegd_s64(int64_t __p0) {
54131 int64_t __ret;
54132 __ret = (int64_t) __builtin_neon_vqnegd_s64(__p0);
54133 return __ret;
54134}
54135__ai int16_t vqnegh_s16(int16_t __p0) {
54136 int16_t __ret;
54137 __ret = (int16_t) __builtin_neon_vqnegh_s16(__p0);
54138 return __ret;
54139}
54140__ai int32_t vqrdmulhs_s32(int32_t __p0, int32_t __p1) {
54141 int32_t __ret;
54142 __ret = (int32_t) __builtin_neon_vqrdmulhs_s32(__p0, __p1);
54143 return __ret;
54144}
54145__ai int16_t vqrdmulhh_s16(int16_t __p0, int16_t __p1) {
54146 int16_t __ret;
54147 __ret = (int16_t) __builtin_neon_vqrdmulhh_s16(__p0, __p1);
54148 return __ret;
54149}
54150#ifdef __LITTLE_ENDIAN__
54151#define vqrdmulhq_lane_s32(__p0, __p1, __p2) __extension__ ({ \
54152 int32x4_t __ret; \
54153 int32x4_t __s0 = __p0; \
54154 int32x2_t __s1 = __p1; \
54155 __ret = (int32x4_t) __builtin_neon_vqrdmulhq_lane_v((int8x16_t)__s0, (int8x8_t)__s1, __p2, 2); \
54156 __ret; \
5246654157})
5246754158#else
52468#define vdup_laneq_u16(__p0_494, __p1_494) __extension__ ({ \
52469 uint16x4_t __ret_494; \
52470 uint16x8_t __s0_494 = __p0_494; \
52471 uint16x8_t __rev0_494; __rev0_494 = __builtin_shufflevector(__s0_494, __s0_494, 7, 6, 5, 4, 3, 2, 1, 0); \
52472 __ret_494 = __noswap_splat_laneq_u16(__rev0_494, __p1_494); \
52473 __ret_494 = __builtin_shufflevector(__ret_494, __ret_494, 3, 2, 1, 0); \
52474 __ret_494; \
54159#define vqrdmulhq_lane_s32(__p0, __p1, __p2) __extension__ ({ \
54160 int32x4_t __ret; \
54161 int32x4_t __s0 = __p0; \
54162 int32x2_t __s1 = __p1; \
54163 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
54164 int32x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
54165 __ret = (int32x4_t) __builtin_neon_vqrdmulhq_lane_v((int8x16_t)__rev0, (int8x8_t)__rev1, __p2, 2); \
54166 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
54167 __ret; \
5247554168})
5247654169#endif
5247754170
5247854171#ifdef __LITTLE_ENDIAN__
52479#define vdup_laneq_s8(__p0_495, __p1_495) __extension__ ({ \
52480 int8x8_t __ret_495; \
52481 int8x16_t __s0_495 = __p0_495; \
52482 __ret_495 = splat_laneq_s8(__s0_495, __p1_495); \
52483 __ret_495; \
54172#define vqrdmulhq_lane_s16(__p0, __p1, __p2) __extension__ ({ \
54173 int16x8_t __ret; \
54174 int16x8_t __s0 = __p0; \
54175 int16x4_t __s1 = __p1; \
54176 __ret = (int16x8_t) __builtin_neon_vqrdmulhq_lane_v((int8x16_t)__s0, (int8x8_t)__s1, __p2, 1); \
54177 __ret; \
5248454178})
5248554179#else
52486#define vdup_laneq_s8(__p0_496, __p1_496) __extension__ ({ \
52487 int8x8_t __ret_496; \
52488 int8x16_t __s0_496 = __p0_496; \
52489 int8x16_t __rev0_496; __rev0_496 = __builtin_shufflevector(__s0_496, __s0_496, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
52490 __ret_496 = __noswap_splat_laneq_s8(__rev0_496, __p1_496); \
52491 __ret_496 = __builtin_shufflevector(__ret_496, __ret_496, 7, 6, 5, 4, 3, 2, 1, 0); \
52492 __ret_496; \
54180#define vqrdmulhq_lane_s16(__p0, __p1, __p2) __extension__ ({ \
54181 int16x8_t __ret; \
54182 int16x8_t __s0 = __p0; \
54183 int16x4_t __s1 = __p1; \
54184 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
54185 int16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
54186 __ret = (int16x8_t) __builtin_neon_vqrdmulhq_lane_v((int8x16_t)__rev0, (int8x8_t)__rev1, __p2, 1); \
54187 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
54188 __ret; \
5249354189})
5249454190#endif
5249554191
5249654192#ifdef __LITTLE_ENDIAN__
52497#define vdup_laneq_f64(__p0_497, __p1_497) __extension__ ({ \
52498 float64x1_t __ret_497; \
52499 float64x2_t __s0_497 = __p0_497; \
52500 __ret_497 = splat_laneq_f64(__s0_497, __p1_497); \
52501 __ret_497; \
54193#define vqrdmulh_lane_s32(__p0, __p1, __p2) __extension__ ({ \
54194 int32x2_t __ret; \
54195 int32x2_t __s0 = __p0; \
54196 int32x2_t __s1 = __p1; \
54197 __ret = (int32x2_t) __builtin_neon_vqrdmulh_lane_v((int8x8_t)__s0, (int8x8_t)__s1, __p2, 2); \
54198 __ret; \
5250254199})
5250354200#else
52504#define vdup_laneq_f64(__p0_498, __p1_498) __extension__ ({ \
52505 float64x1_t __ret_498; \
52506 float64x2_t __s0_498 = __p0_498; \
52507 float64x2_t __rev0_498; __rev0_498 = __builtin_shufflevector(__s0_498, __s0_498, 1, 0); \
52508 __ret_498 = __noswap_splat_laneq_f64(__rev0_498, __p1_498); \
52509 __ret_498; \
54201#define vqrdmulh_lane_s32(__p0, __p1, __p2) __extension__ ({ \
54202 int32x2_t __ret; \
54203 int32x2_t __s0 = __p0; \
54204 int32x2_t __s1 = __p1; \
54205 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
54206 int32x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
54207 __ret = (int32x2_t) __builtin_neon_vqrdmulh_lane_v((int8x8_t)__rev0, (int8x8_t)__rev1, __p2, 2); \
54208 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
54209 __ret; \
5251054210})
5251154211#endif
5251254212
5251354213#ifdef __LITTLE_ENDIAN__
52514#define vdup_laneq_f32(__p0_499, __p1_499) __extension__ ({ \
52515 float32x2_t __ret_499; \
52516 float32x4_t __s0_499 = __p0_499; \
52517 __ret_499 = splat_laneq_f32(__s0_499, __p1_499); \
52518 __ret_499; \
54214#define vqrdmulh_lane_s16(__p0, __p1, __p2) __extension__ ({ \
54215 int16x4_t __ret; \
54216 int16x4_t __s0 = __p0; \
54217 int16x4_t __s1 = __p1; \
54218 __ret = (int16x4_t) __builtin_neon_vqrdmulh_lane_v((int8x8_t)__s0, (int8x8_t)__s1, __p2, 1); \
54219 __ret; \
5251954220})
5252054221#else
52521#define vdup_laneq_f32(__p0_500, __p1_500) __extension__ ({ \
52522 float32x2_t __ret_500; \
52523 float32x4_t __s0_500 = __p0_500; \
52524 float32x4_t __rev0_500; __rev0_500 = __builtin_shufflevector(__s0_500, __s0_500, 3, 2, 1, 0); \
52525 __ret_500 = __noswap_splat_laneq_f32(__rev0_500, __p1_500); \
52526 __ret_500 = __builtin_shufflevector(__ret_500, __ret_500, 1, 0); \
52527 __ret_500; \
54222#define vqrdmulh_lane_s16(__p0, __p1, __p2) __extension__ ({ \
54223 int16x4_t __ret; \
54224 int16x4_t __s0 = __p0; \
54225 int16x4_t __s1 = __p1; \
54226 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
54227 int16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
54228 __ret = (int16x4_t) __builtin_neon_vqrdmulh_lane_v((int8x8_t)__rev0, (int8x8_t)__rev1, __p2, 1); \
54229 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
54230 __ret; \
5252854231})
5252954232#endif
5253054233
5253154234#ifdef __LITTLE_ENDIAN__
52532#define vdup_laneq_f16(__p0_501, __p1_501) __extension__ ({ \
52533 float16x4_t __ret_501; \
52534 float16x8_t __s0_501 = __p0_501; \
52535 __ret_501 = splat_laneq_f16(__s0_501, __p1_501); \
52536 __ret_501; \
54235#define vqrdmulhs_lane_s32(__p0_659, __p1_659, __p2_659) __extension__ ({ \
54236 int32_t __ret_659; \
54237 int32_t __s0_659 = __p0_659; \
54238 int32x2_t __s1_659 = __p1_659; \
54239 __ret_659 = vqrdmulhs_s32(__s0_659, vget_lane_s32(__s1_659, __p2_659)); \
54240 __ret_659; \
5253754241})
5253854242#else
52539#define vdup_laneq_f16(__p0_502, __p1_502) __extension__ ({ \
52540 float16x4_t __ret_502; \
52541 float16x8_t __s0_502 = __p0_502; \
52542 float16x8_t __rev0_502; __rev0_502 = __builtin_shufflevector(__s0_502, __s0_502, 7, 6, 5, 4, 3, 2, 1, 0); \
52543 __ret_502 = __noswap_splat_laneq_f16(__rev0_502, __p1_502); \
52544 __ret_502 = __builtin_shufflevector(__ret_502, __ret_502, 3, 2, 1, 0); \
52545 __ret_502; \
54243#define vqrdmulhs_lane_s32(__p0_660, __p1_660, __p2_660) __extension__ ({ \
54244 int32_t __ret_660; \
54245 int32_t __s0_660 = __p0_660; \
54246 int32x2_t __s1_660 = __p1_660; \
54247 int32x2_t __rev1_660; __rev1_660 = __builtin_shufflevector(__s1_660, __s1_660, 1, 0); \
54248 __ret_660 = vqrdmulhs_s32(__s0_660, __noswap_vget_lane_s32(__rev1_660, __p2_660)); \
54249 __ret_660; \
5254654250})
5254754251#endif
5254854252
5254954253#ifdef __LITTLE_ENDIAN__
52550#define vdup_laneq_s32(__p0_503, __p1_503) __extension__ ({ \
52551 int32x2_t __ret_503; \
52552 int32x4_t __s0_503 = __p0_503; \
52553 __ret_503 = splat_laneq_s32(__s0_503, __p1_503); \
52554 __ret_503; \
54254#define vqrdmulhh_lane_s16(__p0_661, __p1_661, __p2_661) __extension__ ({ \
54255 int16_t __ret_661; \
54256 int16_t __s0_661 = __p0_661; \
54257 int16x4_t __s1_661 = __p1_661; \
54258 __ret_661 = vqrdmulhh_s16(__s0_661, vget_lane_s16(__s1_661, __p2_661)); \
54259 __ret_661; \
5255554260})
5255654261#else
52557#define vdup_laneq_s32(__p0_504, __p1_504) __extension__ ({ \
52558 int32x2_t __ret_504; \
52559 int32x4_t __s0_504 = __p0_504; \
52560 int32x4_t __rev0_504; __rev0_504 = __builtin_shufflevector(__s0_504, __s0_504, 3, 2, 1, 0); \
52561 __ret_504 = __noswap_splat_laneq_s32(__rev0_504, __p1_504); \
52562 __ret_504 = __builtin_shufflevector(__ret_504, __ret_504, 1, 0); \
52563 __ret_504; \
54262#define vqrdmulhh_lane_s16(__p0_662, __p1_662, __p2_662) __extension__ ({ \
54263 int16_t __ret_662; \
54264 int16_t __s0_662 = __p0_662; \
54265 int16x4_t __s1_662 = __p1_662; \
54266 int16x4_t __rev1_662; __rev1_662 = __builtin_shufflevector(__s1_662, __s1_662, 3, 2, 1, 0); \
54267 __ret_662 = vqrdmulhh_s16(__s0_662, __noswap_vget_lane_s16(__rev1_662, __p2_662)); \
54268 __ret_662; \
5256454269})
5256554270#endif
5256654271
5256754272#ifdef __LITTLE_ENDIAN__
52568#define vdup_laneq_s64(__p0_505, __p1_505) __extension__ ({ \
52569 int64x1_t __ret_505; \
52570 int64x2_t __s0_505 = __p0_505; \
52571 __ret_505 = splat_laneq_s64(__s0_505, __p1_505); \
52572 __ret_505; \
54273#define vqrdmulhs_laneq_s32(__p0_663, __p1_663, __p2_663) __extension__ ({ \
54274 int32_t __ret_663; \
54275 int32_t __s0_663 = __p0_663; \
54276 int32x4_t __s1_663 = __p1_663; \
54277 __ret_663 = vqrdmulhs_s32(__s0_663, vgetq_lane_s32(__s1_663, __p2_663)); \
54278 __ret_663; \
5257354279})
5257454280#else
52575#define vdup_laneq_s64(__p0_506, __p1_506) __extension__ ({ \
52576 int64x1_t __ret_506; \
52577 int64x2_t __s0_506 = __p0_506; \
52578 int64x2_t __rev0_506; __rev0_506 = __builtin_shufflevector(__s0_506, __s0_506, 1, 0); \
52579 __ret_506 = __noswap_splat_laneq_s64(__rev0_506, __p1_506); \
52580 __ret_506; \
54281#define vqrdmulhs_laneq_s32(__p0_664, __p1_664, __p2_664) __extension__ ({ \
54282 int32_t __ret_664; \
54283 int32_t __s0_664 = __p0_664; \
54284 int32x4_t __s1_664 = __p1_664; \
54285 int32x4_t __rev1_664; __rev1_664 = __builtin_shufflevector(__s1_664, __s1_664, 3, 2, 1, 0); \
54286 __ret_664 = vqrdmulhs_s32(__s0_664, __noswap_vgetq_lane_s32(__rev1_664, __p2_664)); \
54287 __ret_664; \
5258154288})
5258254289#endif
5258354290
5258454291#ifdef __LITTLE_ENDIAN__
52585#define vdup_laneq_s16(__p0_507, __p1_507) __extension__ ({ \
52586 int16x4_t __ret_507; \
52587 int16x8_t __s0_507 = __p0_507; \
52588 __ret_507 = splat_laneq_s16(__s0_507, __p1_507); \
52589 __ret_507; \
54292#define vqrdmulhh_laneq_s16(__p0_665, __p1_665, __p2_665) __extension__ ({ \
54293 int16_t __ret_665; \
54294 int16_t __s0_665 = __p0_665; \
54295 int16x8_t __s1_665 = __p1_665; \
54296 __ret_665 = vqrdmulhh_s16(__s0_665, vgetq_lane_s16(__s1_665, __p2_665)); \
54297 __ret_665; \
5259054298})
5259154299#else
52592#define vdup_laneq_s16(__p0_508, __p1_508) __extension__ ({ \
52593 int16x4_t __ret_508; \
52594 int16x8_t __s0_508 = __p0_508; \
52595 int16x8_t __rev0_508; __rev0_508 = __builtin_shufflevector(__s0_508, __s0_508, 7, 6, 5, 4, 3, 2, 1, 0); \
52596 __ret_508 = __noswap_splat_laneq_s16(__rev0_508, __p1_508); \
52597 __ret_508 = __builtin_shufflevector(__ret_508, __ret_508, 3, 2, 1, 0); \
52598 __ret_508; \
54300#define vqrdmulhh_laneq_s16(__p0_666, __p1_666, __p2_666) __extension__ ({ \
54301 int16_t __ret_666; \
54302 int16_t __s0_666 = __p0_666; \
54303 int16x8_t __s1_666 = __p1_666; \
54304 int16x8_t __rev1_666; __rev1_666 = __builtin_shufflevector(__s1_666, __s1_666, 7, 6, 5, 4, 3, 2, 1, 0); \
54305 __ret_666 = vqrdmulhh_s16(__s0_666, __noswap_vgetq_lane_s16(__rev1_666, __p2_666)); \
54306 __ret_666; \
5259954307})
5260054308#endif
5260154309
52602__ai poly64x1_t vdup_n_p64(poly64_t __p0) {
52603 poly64x1_t __ret;
52604 __ret = (poly64x1_t) {__p0};
52605 return __ret;
52606}
5260754310#ifdef __LITTLE_ENDIAN__
52608__ai poly64x2_t vdupq_n_p64(poly64_t __p0) {
52609 poly64x2_t __ret;
52610 __ret = (poly64x2_t) {__p0, __p0};
52611 return __ret;
52612}
54311#define vqrdmulhq_laneq_s32(__p0, __p1, __p2) __extension__ ({ \
54312 int32x4_t __ret; \
54313 int32x4_t __s0 = __p0; \
54314 int32x4_t __s1 = __p1; \
54315 __ret = (int32x4_t) __builtin_neon_vqrdmulhq_laneq_v((int8x16_t)__s0, (int8x16_t)__s1, __p2, 34); \
54316 __ret; \
54317})
5261354318#else
52614__ai poly64x2_t vdupq_n_p64(poly64_t __p0) {
52615 poly64x2_t __ret;
52616 __ret = (poly64x2_t) {__p0, __p0};
52617 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
52618 return __ret;
52619}
54319#define vqrdmulhq_laneq_s32(__p0, __p1, __p2) __extension__ ({ \
54320 int32x4_t __ret; \
54321 int32x4_t __s0 = __p0; \
54322 int32x4_t __s1 = __p1; \
54323 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
54324 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
54325 __ret = (int32x4_t) __builtin_neon_vqrdmulhq_laneq_v((int8x16_t)__rev0, (int8x16_t)__rev1, __p2, 34); \
54326 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
54327 __ret; \
54328})
5262054329#endif
5262154330
5262254331#ifdef __LITTLE_ENDIAN__
52623__ai float64x2_t vdupq_n_f64(float64_t __p0) {
52624 float64x2_t __ret;
52625 __ret = (float64x2_t) {__p0, __p0};
52626 return __ret;
52627}
54332#define vqrdmulhq_laneq_s16(__p0, __p1, __p2) __extension__ ({ \
54333 int16x8_t __ret; \
54334 int16x8_t __s0 = __p0; \
54335 int16x8_t __s1 = __p1; \
54336 __ret = (int16x8_t) __builtin_neon_vqrdmulhq_laneq_v((int8x16_t)__s0, (int8x16_t)__s1, __p2, 33); \
54337 __ret; \
54338})
5262854339#else
52629__ai float64x2_t vdupq_n_f64(float64_t __p0) {
52630 float64x2_t __ret;
52631 __ret = (float64x2_t) {__p0, __p0};
52632 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
52633 return __ret;
52634}
52635#endif
52636
52637__ai float64x1_t vdup_n_f64(float64_t __p0) {
52638 float64x1_t __ret;
52639 __ret = (float64x1_t) {__p0};
52640 return __ret;
52641}
52642#define vext_p64(__p0, __p1, __p2) __extension__ ({ \
52643 poly64x1_t __ret; \
52644 poly64x1_t __s0 = __p0; \
52645 poly64x1_t __s1 = __p1; \
52646 __ret = (poly64x1_t) __builtin_neon_vext_v((int8x8_t)__s0, (int8x8_t)__s1, __p2, 6); \
54340#define vqrdmulhq_laneq_s16(__p0, __p1, __p2) __extension__ ({ \
54341 int16x8_t __ret; \
54342 int16x8_t __s0 = __p0; \
54343 int16x8_t __s1 = __p1; \
54344 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
54345 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
54346 __ret = (int16x8_t) __builtin_neon_vqrdmulhq_laneq_v((int8x16_t)__rev0, (int8x16_t)__rev1, __p2, 33); \
54347 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
5264754348 __ret; \
5264854349})
54350#endif
54351
5264954352#ifdef __LITTLE_ENDIAN__
52650#define vextq_p64(__p0, __p1, __p2) __extension__ ({ \
52651 poly64x2_t __ret; \
52652 poly64x2_t __s0 = __p0; \
52653 poly64x2_t __s1 = __p1; \
52654 __ret = (poly64x2_t) __builtin_neon_vextq_v((int8x16_t)__s0, (int8x16_t)__s1, __p2, 38); \
54353#define vqrdmulh_laneq_s32(__p0, __p1, __p2) __extension__ ({ \
54354 int32x2_t __ret; \
54355 int32x2_t __s0 = __p0; \
54356 int32x4_t __s1 = __p1; \
54357 __ret = (int32x2_t) __builtin_neon_vqrdmulh_laneq_v((int8x8_t)__s0, (int8x16_t)__s1, __p2, 2); \
5265554358 __ret; \
5265654359})
5265754360#else
52658#define vextq_p64(__p0, __p1, __p2) __extension__ ({ \
52659 poly64x2_t __ret; \
52660 poly64x2_t __s0 = __p0; \
52661 poly64x2_t __s1 = __p1; \
52662 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
52663 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
52664 __ret = (poly64x2_t) __builtin_neon_vextq_v((int8x16_t)__rev0, (int8x16_t)__rev1, __p2, 38); \
54361#define vqrdmulh_laneq_s32(__p0, __p1, __p2) __extension__ ({ \
54362 int32x2_t __ret; \
54363 int32x2_t __s0 = __p0; \
54364 int32x4_t __s1 = __p1; \
54365 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
54366 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
54367 __ret = (int32x2_t) __builtin_neon_vqrdmulh_laneq_v((int8x8_t)__rev0, (int8x16_t)__rev1, __p2, 2); \
5266554368 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
5266654369 __ret; \
5266754370})
5266854371#endif
5266954372
5267054373#ifdef __LITTLE_ENDIAN__
52671#define vextq_f64(__p0, __p1, __p2) __extension__ ({ \
52672 float64x2_t __ret; \
52673 float64x2_t __s0 = __p0; \
52674 float64x2_t __s1 = __p1; \
52675 __ret = (float64x2_t) __builtin_neon_vextq_v((int8x16_t)__s0, (int8x16_t)__s1, __p2, 42); \
54374#define vqrdmulh_laneq_s16(__p0, __p1, __p2) __extension__ ({ \
54375 int16x4_t __ret; \
54376 int16x4_t __s0 = __p0; \
54377 int16x8_t __s1 = __p1; \
54378 __ret = (int16x4_t) __builtin_neon_vqrdmulh_laneq_v((int8x8_t)__s0, (int8x16_t)__s1, __p2, 1); \
5267654379 __ret; \
5267754380})
5267854381#else
52679#define vextq_f64(__p0, __p1, __p2) __extension__ ({ \
52680 float64x2_t __ret; \
52681 float64x2_t __s0 = __p0; \
52682 float64x2_t __s1 = __p1; \
52683 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
52684 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
52685 __ret = (float64x2_t) __builtin_neon_vextq_v((int8x16_t)__rev0, (int8x16_t)__rev1, __p2, 42); \
52686 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
54382#define vqrdmulh_laneq_s16(__p0, __p1, __p2) __extension__ ({ \
54383 int16x4_t __ret; \
54384 int16x4_t __s0 = __p0; \
54385 int16x8_t __s1 = __p1; \
54386 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
54387 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
54388 __ret = (int16x4_t) __builtin_neon_vqrdmulh_laneq_v((int8x8_t)__rev0, (int8x16_t)__rev1, __p2, 1); \
54389 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
5268754390 __ret; \
5268854391})
5268954392#endif
5269054393
52691#define vext_f64(__p0, __p1, __p2) __extension__ ({ \
52692 float64x1_t __ret; \
52693 float64x1_t __s0 = __p0; \
52694 float64x1_t __s1 = __p1; \
52695 __ret = (float64x1_t) __builtin_neon_vext_v((int8x8_t)__s0, (int8x8_t)__s1, __p2, 10); \
52696 __ret; \
52697})
52698#ifdef __LITTLE_ENDIAN__
52699__ai float64x2_t vfmaq_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
52700 float64x2_t __ret;
52701 __ret = (float64x2_t) __builtin_neon_vfmaq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 42);
54394__ai uint8_t vqrshlb_u8(uint8_t __p0, int8_t __p1) {
54395 uint8_t __ret;
54396 __ret = (uint8_t) __builtin_neon_vqrshlb_u8(__p0, __p1);
5270254397 return __ret;
5270354398}
52704#else
52705__ai float64x2_t vfmaq_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
52706 float64x2_t __ret;
52707 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
52708 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
52709 float64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
52710 __ret = (float64x2_t) __builtin_neon_vfmaq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 42);
52711 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
54399__ai uint32_t vqrshls_u32(uint32_t __p0, int32_t __p1) {
54400 uint32_t __ret;
54401 __ret = (uint32_t) __builtin_neon_vqrshls_u32(__p0, __p1);
5271254402 return __ret;
5271354403}
52714__ai float64x2_t __noswap_vfmaq_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
52715 float64x2_t __ret;
52716 __ret = (float64x2_t) __builtin_neon_vfmaq_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 42);
54404__ai uint64_t vqrshld_u64(uint64_t __p0, int64_t __p1) {
54405 uint64_t __ret;
54406 __ret = (uint64_t) __builtin_neon_vqrshld_u64(__p0, __p1);
5271754407 return __ret;
5271854408}
52719#endif
52720
52721__ai float64x1_t vfma_f64(float64x1_t __p0, float64x1_t __p1, float64x1_t __p2) {
52722 float64x1_t __ret;
52723 __ret = (float64x1_t) __builtin_neon_vfma_v((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 10);
54409__ai uint16_t vqrshlh_u16(uint16_t __p0, int16_t __p1) {
54410 uint16_t __ret;
54411 __ret = (uint16_t) __builtin_neon_vqrshlh_u16(__p0, __p1);
54412 return __ret;
54413}
54414__ai int8_t vqrshlb_s8(int8_t __p0, int8_t __p1) {
54415 int8_t __ret;
54416 __ret = (int8_t) __builtin_neon_vqrshlb_s8(__p0, __p1);
54417 return __ret;
54418}
54419__ai int32_t vqrshls_s32(int32_t __p0, int32_t __p1) {
54420 int32_t __ret;
54421 __ret = (int32_t) __builtin_neon_vqrshls_s32(__p0, __p1);
54422 return __ret;
54423}
54424__ai int64_t vqrshld_s64(int64_t __p0, int64_t __p1) {
54425 int64_t __ret;
54426 __ret = (int64_t) __builtin_neon_vqrshld_s64(__p0, __p1);
54427 return __ret;
54428}
54429__ai int16_t vqrshlh_s16(int16_t __p0, int16_t __p1) {
54430 int16_t __ret;
54431 __ret = (int16_t) __builtin_neon_vqrshlh_s16(__p0, __p1);
5272454432 return __ret;
5272554433}
52726#define vfmad_lane_f64(__p0, __p1, __p2, __p3) __extension__ ({ \
52727 float64_t __ret; \
52728 float64_t __s0 = __p0; \
52729 float64_t __s1 = __p1; \
52730 float64x1_t __s2 = __p2; \
52731 __ret = (float64_t) __builtin_neon_vfmad_lane_f64(__s0, __s1, (float64x1_t)__s2, __p3); \
52732 __ret; \
52733})
5273454434#ifdef __LITTLE_ENDIAN__
52735#define vfmas_lane_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
52736 float32_t __ret; \
52737 float32_t __s0 = __p0; \
52738 float32_t __s1 = __p1; \
52739 float32x2_t __s2 = __p2; \
52740 __ret = (float32_t) __builtin_neon_vfmas_lane_f32(__s0, __s1, (float32x2_t)__s2, __p3); \
52741 __ret; \
54435#define vqrshrn_high_n_u32(__p0_667, __p1_667, __p2_667) __extension__ ({ \
54436 uint16x8_t __ret_667; \
54437 uint16x4_t __s0_667 = __p0_667; \
54438 uint32x4_t __s1_667 = __p1_667; \
54439 __ret_667 = (uint16x8_t)(vcombine_u16((uint16x4_t)(__s0_667), (uint16x4_t)(vqrshrn_n_u32(__s1_667, __p2_667)))); \
54440 __ret_667; \
5274254441})
5274354442#else
52744#define vfmas_lane_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
52745 float32_t __ret; \
52746 float32_t __s0 = __p0; \
52747 float32_t __s1 = __p1; \
52748 float32x2_t __s2 = __p2; \
52749 float32x2_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 1, 0); \
52750 __ret = (float32_t) __builtin_neon_vfmas_lane_f32(__s0, __s1, (float32x2_t)__rev2, __p3); \
52751 __ret; \
52752})
52753#define __noswap_vfmas_lane_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
52754 float32_t __ret; \
52755 float32_t __s0 = __p0; \
52756 float32_t __s1 = __p1; \
52757 float32x2_t __s2 = __p2; \
52758 __ret = (float32_t) __builtin_neon_vfmas_lane_f32(__s0, __s1, (float32x2_t)__s2, __p3); \
52759 __ret; \
54443#define vqrshrn_high_n_u32(__p0_668, __p1_668, __p2_668) __extension__ ({ \
54444 uint16x8_t __ret_668; \
54445 uint16x4_t __s0_668 = __p0_668; \
54446 uint32x4_t __s1_668 = __p1_668; \
54447 uint16x4_t __rev0_668; __rev0_668 = __builtin_shufflevector(__s0_668, __s0_668, 3, 2, 1, 0); \
54448 uint32x4_t __rev1_668; __rev1_668 = __builtin_shufflevector(__s1_668, __s1_668, 3, 2, 1, 0); \
54449 __ret_668 = (uint16x8_t)(__noswap_vcombine_u16((uint16x4_t)(__rev0_668), (uint16x4_t)(__noswap_vqrshrn_n_u32(__rev1_668, __p2_668)))); \
54450 __ret_668 = __builtin_shufflevector(__ret_668, __ret_668, 7, 6, 5, 4, 3, 2, 1, 0); \
54451 __ret_668; \
5276054452})
5276154453#endif
5276254454
5276354455#ifdef __LITTLE_ENDIAN__
52764#define vfmaq_lane_f64(__p0, __p1, __p2, __p3) __extension__ ({ \
52765 float64x2_t __ret; \
52766 float64x2_t __s0 = __p0; \
52767 float64x2_t __s1 = __p1; \
52768 float64x1_t __s2 = __p2; \
52769 __ret = (float64x2_t) __builtin_neon_vfmaq_lane_v((int8x16_t)__s0, (int8x16_t)__s1, (int8x8_t)__s2, __p3, 42); \
52770 __ret; \
54456#define vqrshrn_high_n_u64(__p0_669, __p1_669, __p2_669) __extension__ ({ \
54457 uint32x4_t __ret_669; \
54458 uint32x2_t __s0_669 = __p0_669; \
54459 uint64x2_t __s1_669 = __p1_669; \
54460 __ret_669 = (uint32x4_t)(vcombine_u32((uint32x2_t)(__s0_669), (uint32x2_t)(vqrshrn_n_u64(__s1_669, __p2_669)))); \
54461 __ret_669; \
5277154462})
5277254463#else
52773#define vfmaq_lane_f64(__p0, __p1, __p2, __p3) __extension__ ({ \
52774 float64x2_t __ret; \
52775 float64x2_t __s0 = __p0; \
52776 float64x2_t __s1 = __p1; \
52777 float64x1_t __s2 = __p2; \
52778 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
52779 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
52780 __ret = (float64x2_t) __builtin_neon_vfmaq_lane_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x8_t)__s2, __p3, 42); \
52781 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
52782 __ret; \
52783})
52784#define __noswap_vfmaq_lane_f64(__p0, __p1, __p2, __p3) __extension__ ({ \
52785 float64x2_t __ret; \
52786 float64x2_t __s0 = __p0; \
52787 float64x2_t __s1 = __p1; \
52788 float64x1_t __s2 = __p2; \
52789 __ret = (float64x2_t) __builtin_neon_vfmaq_lane_v((int8x16_t)__s0, (int8x16_t)__s1, (int8x8_t)__s2, __p3, 42); \
52790 __ret; \
54464#define vqrshrn_high_n_u64(__p0_670, __p1_670, __p2_670) __extension__ ({ \
54465 uint32x4_t __ret_670; \
54466 uint32x2_t __s0_670 = __p0_670; \
54467 uint64x2_t __s1_670 = __p1_670; \
54468 uint32x2_t __rev0_670; __rev0_670 = __builtin_shufflevector(__s0_670, __s0_670, 1, 0); \
54469 uint64x2_t __rev1_670; __rev1_670 = __builtin_shufflevector(__s1_670, __s1_670, 1, 0); \
54470 __ret_670 = (uint32x4_t)(__noswap_vcombine_u32((uint32x2_t)(__rev0_670), (uint32x2_t)(__noswap_vqrshrn_n_u64(__rev1_670, __p2_670)))); \
54471 __ret_670 = __builtin_shufflevector(__ret_670, __ret_670, 3, 2, 1, 0); \
54472 __ret_670; \
5279154473})
5279254474#endif
5279354475
5279454476#ifdef __LITTLE_ENDIAN__
52795#define vfmaq_lane_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
52796 float32x4_t __ret; \
52797 float32x4_t __s0 = __p0; \
52798 float32x4_t __s1 = __p1; \
52799 float32x2_t __s2 = __p2; \
52800 __ret = (float32x4_t) __builtin_neon_vfmaq_lane_v((int8x16_t)__s0, (int8x16_t)__s1, (int8x8_t)__s2, __p3, 41); \
52801 __ret; \
54477#define vqrshrn_high_n_u16(__p0_671, __p1_671, __p2_671) __extension__ ({ \
54478 uint8x16_t __ret_671; \
54479 uint8x8_t __s0_671 = __p0_671; \
54480 uint16x8_t __s1_671 = __p1_671; \
54481 __ret_671 = (uint8x16_t)(vcombine_u8((uint8x8_t)(__s0_671), (uint8x8_t)(vqrshrn_n_u16(__s1_671, __p2_671)))); \
54482 __ret_671; \
5280254483})
5280354484#else
52804#define vfmaq_lane_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
52805 float32x4_t __ret; \
52806 float32x4_t __s0 = __p0; \
52807 float32x4_t __s1 = __p1; \
52808 float32x2_t __s2 = __p2; \
52809 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
52810 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
52811 float32x2_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 1, 0); \
52812 __ret = (float32x4_t) __builtin_neon_vfmaq_lane_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x8_t)__rev2, __p3, 41); \
52813 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
52814 __ret; \
52815})
52816#define __noswap_vfmaq_lane_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
52817 float32x4_t __ret; \
52818 float32x4_t __s0 = __p0; \
52819 float32x4_t __s1 = __p1; \
52820 float32x2_t __s2 = __p2; \
52821 __ret = (float32x4_t) __builtin_neon_vfmaq_lane_v((int8x16_t)__s0, (int8x16_t)__s1, (int8x8_t)__s2, __p3, 41); \
52822 __ret; \
54485#define vqrshrn_high_n_u16(__p0_672, __p1_672, __p2_672) __extension__ ({ \
54486 uint8x16_t __ret_672; \
54487 uint8x8_t __s0_672 = __p0_672; \
54488 uint16x8_t __s1_672 = __p1_672; \
54489 uint8x8_t __rev0_672; __rev0_672 = __builtin_shufflevector(__s0_672, __s0_672, 7, 6, 5, 4, 3, 2, 1, 0); \
54490 uint16x8_t __rev1_672; __rev1_672 = __builtin_shufflevector(__s1_672, __s1_672, 7, 6, 5, 4, 3, 2, 1, 0); \
54491 __ret_672 = (uint8x16_t)(__noswap_vcombine_u8((uint8x8_t)(__rev0_672), (uint8x8_t)(__noswap_vqrshrn_n_u16(__rev1_672, __p2_672)))); \
54492 __ret_672 = __builtin_shufflevector(__ret_672, __ret_672, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54493 __ret_672; \
5282354494})
5282454495#endif
5282554496
52826#define vfma_lane_f64(__p0, __p1, __p2, __p3) __extension__ ({ \
52827 float64x1_t __ret; \
52828 float64x1_t __s0 = __p0; \
52829 float64x1_t __s1 = __p1; \
52830 float64x1_t __s2 = __p2; \
52831 __ret = (float64x1_t) __builtin_neon_vfma_lane_v((int8x8_t)__s0, (int8x8_t)__s1, (int8x8_t)__s2, __p3, 10); \
52832 __ret; \
52833})
5283454497#ifdef __LITTLE_ENDIAN__
52835#define vfma_lane_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
52836 float32x2_t __ret; \
52837 float32x2_t __s0 = __p0; \
52838 float32x2_t __s1 = __p1; \
52839 float32x2_t __s2 = __p2; \
52840 __ret = (float32x2_t) __builtin_neon_vfma_lane_v((int8x8_t)__s0, (int8x8_t)__s1, (int8x8_t)__s2, __p3, 9); \
52841 __ret; \
54498#define vqrshrn_high_n_s32(__p0_673, __p1_673, __p2_673) __extension__ ({ \
54499 int16x8_t __ret_673; \
54500 int16x4_t __s0_673 = __p0_673; \
54501 int32x4_t __s1_673 = __p1_673; \
54502 __ret_673 = (int16x8_t)(vcombine_s16((int16x4_t)(__s0_673), (int16x4_t)(vqrshrn_n_s32(__s1_673, __p2_673)))); \
54503 __ret_673; \
5284254504})
5284354505#else
52844#define vfma_lane_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
52845 float32x2_t __ret; \
52846 float32x2_t __s0 = __p0; \
52847 float32x2_t __s1 = __p1; \
52848 float32x2_t __s2 = __p2; \
52849 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
52850 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
52851 float32x2_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 1, 0); \
52852 __ret = (float32x2_t) __builtin_neon_vfma_lane_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, __p3, 9); \
52853 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
52854 __ret; \
52855})
52856#define __noswap_vfma_lane_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
52857 float32x2_t __ret; \
52858 float32x2_t __s0 = __p0; \
52859 float32x2_t __s1 = __p1; \
52860 float32x2_t __s2 = __p2; \
52861 __ret = (float32x2_t) __builtin_neon_vfma_lane_v((int8x8_t)__s0, (int8x8_t)__s1, (int8x8_t)__s2, __p3, 9); \
52862 __ret; \
54506#define vqrshrn_high_n_s32(__p0_674, __p1_674, __p2_674) __extension__ ({ \
54507 int16x8_t __ret_674; \
54508 int16x4_t __s0_674 = __p0_674; \
54509 int32x4_t __s1_674 = __p1_674; \
54510 int16x4_t __rev0_674; __rev0_674 = __builtin_shufflevector(__s0_674, __s0_674, 3, 2, 1, 0); \
54511 int32x4_t __rev1_674; __rev1_674 = __builtin_shufflevector(__s1_674, __s1_674, 3, 2, 1, 0); \
54512 __ret_674 = (int16x8_t)(__noswap_vcombine_s16((int16x4_t)(__rev0_674), (int16x4_t)(__noswap_vqrshrn_n_s32(__rev1_674, __p2_674)))); \
54513 __ret_674 = __builtin_shufflevector(__ret_674, __ret_674, 7, 6, 5, 4, 3, 2, 1, 0); \
54514 __ret_674; \
5286354515})
5286454516#endif
5286554517
5286654518#ifdef __LITTLE_ENDIAN__
52867#define vfmad_laneq_f64(__p0, __p1, __p2, __p3) __extension__ ({ \
52868 float64_t __ret; \
52869 float64_t __s0 = __p0; \
52870 float64_t __s1 = __p1; \
52871 float64x2_t __s2 = __p2; \
52872 __ret = (float64_t) __builtin_neon_vfmad_laneq_f64(__s0, __s1, (float64x2_t)__s2, __p3); \
52873 __ret; \
54519#define vqrshrn_high_n_s64(__p0_675, __p1_675, __p2_675) __extension__ ({ \
54520 int32x4_t __ret_675; \
54521 int32x2_t __s0_675 = __p0_675; \
54522 int64x2_t __s1_675 = __p1_675; \
54523 __ret_675 = (int32x4_t)(vcombine_s32((int32x2_t)(__s0_675), (int32x2_t)(vqrshrn_n_s64(__s1_675, __p2_675)))); \
54524 __ret_675; \
5287454525})
5287554526#else
52876#define vfmad_laneq_f64(__p0, __p1, __p2, __p3) __extension__ ({ \
52877 float64_t __ret; \
52878 float64_t __s0 = __p0; \
52879 float64_t __s1 = __p1; \
52880 float64x2_t __s2 = __p2; \
52881 float64x2_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 1, 0); \
52882 __ret = (float64_t) __builtin_neon_vfmad_laneq_f64(__s0, __s1, (float64x2_t)__rev2, __p3); \
52883 __ret; \
52884})
52885#define __noswap_vfmad_laneq_f64(__p0, __p1, __p2, __p3) __extension__ ({ \
52886 float64_t __ret; \
52887 float64_t __s0 = __p0; \
52888 float64_t __s1 = __p1; \
52889 float64x2_t __s2 = __p2; \
52890 __ret = (float64_t) __builtin_neon_vfmad_laneq_f64(__s0, __s1, (float64x2_t)__s2, __p3); \
52891 __ret; \
54527#define vqrshrn_high_n_s64(__p0_676, __p1_676, __p2_676) __extension__ ({ \
54528 int32x4_t __ret_676; \
54529 int32x2_t __s0_676 = __p0_676; \
54530 int64x2_t __s1_676 = __p1_676; \
54531 int32x2_t __rev0_676; __rev0_676 = __builtin_shufflevector(__s0_676, __s0_676, 1, 0); \
54532 int64x2_t __rev1_676; __rev1_676 = __builtin_shufflevector(__s1_676, __s1_676, 1, 0); \
54533 __ret_676 = (int32x4_t)(__noswap_vcombine_s32((int32x2_t)(__rev0_676), (int32x2_t)(__noswap_vqrshrn_n_s64(__rev1_676, __p2_676)))); \
54534 __ret_676 = __builtin_shufflevector(__ret_676, __ret_676, 3, 2, 1, 0); \
54535 __ret_676; \
5289254536})
5289354537#endif
5289454538
5289554539#ifdef __LITTLE_ENDIAN__
52896#define vfmas_laneq_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
52897 float32_t __ret; \
52898 float32_t __s0 = __p0; \
52899 float32_t __s1 = __p1; \
52900 float32x4_t __s2 = __p2; \
52901 __ret = (float32_t) __builtin_neon_vfmas_laneq_f32(__s0, __s1, (float32x4_t)__s2, __p3); \
52902 __ret; \
54540#define vqrshrn_high_n_s16(__p0_677, __p1_677, __p2_677) __extension__ ({ \
54541 int8x16_t __ret_677; \
54542 int8x8_t __s0_677 = __p0_677; \
54543 int16x8_t __s1_677 = __p1_677; \
54544 __ret_677 = (int8x16_t)(vcombine_s8((int8x8_t)(__s0_677), (int8x8_t)(vqrshrn_n_s16(__s1_677, __p2_677)))); \
54545 __ret_677; \
5290354546})
5290454547#else
52905#define vfmas_laneq_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
52906 float32_t __ret; \
52907 float32_t __s0 = __p0; \
52908 float32_t __s1 = __p1; \
52909 float32x4_t __s2 = __p2; \
52910 float32x4_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 3, 2, 1, 0); \
52911 __ret = (float32_t) __builtin_neon_vfmas_laneq_f32(__s0, __s1, (float32x4_t)__rev2, __p3); \
52912 __ret; \
52913})
52914#define __noswap_vfmas_laneq_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
52915 float32_t __ret; \
52916 float32_t __s0 = __p0; \
52917 float32_t __s1 = __p1; \
52918 float32x4_t __s2 = __p2; \
52919 __ret = (float32_t) __builtin_neon_vfmas_laneq_f32(__s0, __s1, (float32x4_t)__s2, __p3); \
52920 __ret; \
54548#define vqrshrn_high_n_s16(__p0_678, __p1_678, __p2_678) __extension__ ({ \
54549 int8x16_t __ret_678; \
54550 int8x8_t __s0_678 = __p0_678; \
54551 int16x8_t __s1_678 = __p1_678; \
54552 int8x8_t __rev0_678; __rev0_678 = __builtin_shufflevector(__s0_678, __s0_678, 7, 6, 5, 4, 3, 2, 1, 0); \
54553 int16x8_t __rev1_678; __rev1_678 = __builtin_shufflevector(__s1_678, __s1_678, 7, 6, 5, 4, 3, 2, 1, 0); \
54554 __ret_678 = (int8x16_t)(__noswap_vcombine_s8((int8x8_t)(__rev0_678), (int8x8_t)(__noswap_vqrshrn_n_s16(__rev1_678, __p2_678)))); \
54555 __ret_678 = __builtin_shufflevector(__ret_678, __ret_678, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54556 __ret_678; \
5292154557})
5292254558#endif
5292354559
52924#ifdef __LITTLE_ENDIAN__
52925#define vfmaq_laneq_f64(__p0, __p1, __p2, __p3) __extension__ ({ \
52926 float64x2_t __ret; \
52927 float64x2_t __s0 = __p0; \
52928 float64x2_t __s1 = __p1; \
52929 float64x2_t __s2 = __p2; \
52930 __ret = (float64x2_t) __builtin_neon_vfmaq_laneq_v((int8x16_t)__s0, (int8x16_t)__s1, (int8x16_t)__s2, __p3, 42); \
54560#define vqrshrns_n_u32(__p0, __p1) __extension__ ({ \
54561 uint16_t __ret; \
54562 uint32_t __s0 = __p0; \
54563 __ret = (uint16_t) __builtin_neon_vqrshrns_n_u32(__s0, __p1); \
5293154564 __ret; \
5293254565})
52933#else
52934#define vfmaq_laneq_f64(__p0, __p1, __p2, __p3) __extension__ ({ \
52935 float64x2_t __ret; \
52936 float64x2_t __s0 = __p0; \
52937 float64x2_t __s1 = __p1; \
52938 float64x2_t __s2 = __p2; \
52939 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
52940 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
52941 float64x2_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 1, 0); \
52942 __ret = (float64x2_t) __builtin_neon_vfmaq_laneq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, __p3, 42); \
52943 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
54566#define vqrshrnd_n_u64(__p0, __p1) __extension__ ({ \
54567 uint32_t __ret; \
54568 uint64_t __s0 = __p0; \
54569 __ret = (uint32_t) __builtin_neon_vqrshrnd_n_u64(__s0, __p1); \
5294454570 __ret; \
5294554571})
52946#define __noswap_vfmaq_laneq_f64(__p0, __p1, __p2, __p3) __extension__ ({ \
52947 float64x2_t __ret; \
52948 float64x2_t __s0 = __p0; \
52949 float64x2_t __s1 = __p1; \
52950 float64x2_t __s2 = __p2; \
52951 __ret = (float64x2_t) __builtin_neon_vfmaq_laneq_v((int8x16_t)__s0, (int8x16_t)__s1, (int8x16_t)__s2, __p3, 42); \
54572#define vqrshrnh_n_u16(__p0, __p1) __extension__ ({ \
54573 uint8_t __ret; \
54574 uint16_t __s0 = __p0; \
54575 __ret = (uint8_t) __builtin_neon_vqrshrnh_n_u16(__s0, __p1); \
5295254576 __ret; \
5295354577})
52954#endif
52955
52956#ifdef __LITTLE_ENDIAN__
52957#define vfmaq_laneq_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
52958 float32x4_t __ret; \
52959 float32x4_t __s0 = __p0; \
52960 float32x4_t __s1 = __p1; \
52961 float32x4_t __s2 = __p2; \
52962 __ret = (float32x4_t) __builtin_neon_vfmaq_laneq_v((int8x16_t)__s0, (int8x16_t)__s1, (int8x16_t)__s2, __p3, 41); \
54578#define vqrshrns_n_s32(__p0, __p1) __extension__ ({ \
54579 int16_t __ret; \
54580 int32_t __s0 = __p0; \
54581 __ret = (int16_t) __builtin_neon_vqrshrns_n_s32(__s0, __p1); \
5296354582 __ret; \
5296454583})
52965#else
52966#define vfmaq_laneq_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
52967 float32x4_t __ret; \
52968 float32x4_t __s0 = __p0; \
52969 float32x4_t __s1 = __p1; \
52970 float32x4_t __s2 = __p2; \
52971 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
52972 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
52973 float32x4_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 3, 2, 1, 0); \
52974 __ret = (float32x4_t) __builtin_neon_vfmaq_laneq_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, __p3, 41); \
52975 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
54584#define vqrshrnd_n_s64(__p0, __p1) __extension__ ({ \
54585 int32_t __ret; \
54586 int64_t __s0 = __p0; \
54587 __ret = (int32_t) __builtin_neon_vqrshrnd_n_s64(__s0, __p1); \
5297654588 __ret; \
5297754589})
52978#define __noswap_vfmaq_laneq_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
52979 float32x4_t __ret; \
52980 float32x4_t __s0 = __p0; \
52981 float32x4_t __s1 = __p1; \
52982 float32x4_t __s2 = __p2; \
52983 __ret = (float32x4_t) __builtin_neon_vfmaq_laneq_v((int8x16_t)__s0, (int8x16_t)__s1, (int8x16_t)__s2, __p3, 41); \
54590#define vqrshrnh_n_s16(__p0, __p1) __extension__ ({ \
54591 int8_t __ret; \
54592 int16_t __s0 = __p0; \
54593 __ret = (int8_t) __builtin_neon_vqrshrnh_n_s16(__s0, __p1); \
5298454594 __ret; \
5298554595})
52986#endif
52987
5298854596#ifdef __LITTLE_ENDIAN__
52989#define vfma_laneq_f64(__p0, __p1, __p2, __p3) __extension__ ({ \
52990 float64x1_t __ret; \
52991 float64x1_t __s0 = __p0; \
52992 float64x1_t __s1 = __p1; \
52993 float64x2_t __s2 = __p2; \
52994 __ret = (float64x1_t) __builtin_neon_vfma_laneq_v((int8x8_t)__s0, (int8x8_t)__s1, (int8x16_t)__s2, __p3, 10); \
52995 __ret; \
54597#define vqrshrun_high_n_s32(__p0_679, __p1_679, __p2_679) __extension__ ({ \
54598 int16x8_t __ret_679; \
54599 int16x4_t __s0_679 = __p0_679; \
54600 int32x4_t __s1_679 = __p1_679; \
54601 __ret_679 = (int16x8_t)(vcombine_s16((int16x4_t)(__s0_679), (int16x4_t)(vqrshrun_n_s32(__s1_679, __p2_679)))); \
54602 __ret_679; \
5299654603})
5299754604#else
52998#define vfma_laneq_f64(__p0, __p1, __p2, __p3) __extension__ ({ \
52999 float64x1_t __ret; \
53000 float64x1_t __s0 = __p0; \
53001 float64x1_t __s1 = __p1; \
53002 float64x2_t __s2 = __p2; \
53003 float64x2_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 1, 0); \
53004 __ret = (float64x1_t) __builtin_neon_vfma_laneq_v((int8x8_t)__s0, (int8x8_t)__s1, (int8x16_t)__rev2, __p3, 10); \
53005 __ret; \
54605#define vqrshrun_high_n_s32(__p0_680, __p1_680, __p2_680) __extension__ ({ \
54606 int16x8_t __ret_680; \
54607 int16x4_t __s0_680 = __p0_680; \
54608 int32x4_t __s1_680 = __p1_680; \
54609 int16x4_t __rev0_680; __rev0_680 = __builtin_shufflevector(__s0_680, __s0_680, 3, 2, 1, 0); \
54610 int32x4_t __rev1_680; __rev1_680 = __builtin_shufflevector(__s1_680, __s1_680, 3, 2, 1, 0); \
54611 __ret_680 = (int16x8_t)(__noswap_vcombine_s16((int16x4_t)(__rev0_680), (int16x4_t)(__noswap_vqrshrun_n_s32(__rev1_680, __p2_680)))); \
54612 __ret_680 = __builtin_shufflevector(__ret_680, __ret_680, 7, 6, 5, 4, 3, 2, 1, 0); \
54613 __ret_680; \
54614})
54615#endif
54616
54617#ifdef __LITTLE_ENDIAN__
54618#define vqrshrun_high_n_s64(__p0_681, __p1_681, __p2_681) __extension__ ({ \
54619 int32x4_t __ret_681; \
54620 int32x2_t __s0_681 = __p0_681; \
54621 int64x2_t __s1_681 = __p1_681; \
54622 __ret_681 = (int32x4_t)(vcombine_s32((int32x2_t)(__s0_681), (int32x2_t)(vqrshrun_n_s64(__s1_681, __p2_681)))); \
54623 __ret_681; \
5300654624})
53007#define __noswap_vfma_laneq_f64(__p0, __p1, __p2, __p3) __extension__ ({ \
53008 float64x1_t __ret; \
53009 float64x1_t __s0 = __p0; \
53010 float64x1_t __s1 = __p1; \
53011 float64x2_t __s2 = __p2; \
53012 __ret = (float64x1_t) __builtin_neon_vfma_laneq_v((int8x8_t)__s0, (int8x8_t)__s1, (int8x16_t)__s2, __p3, 10); \
53013 __ret; \
54625#else
54626#define vqrshrun_high_n_s64(__p0_682, __p1_682, __p2_682) __extension__ ({ \
54627 int32x4_t __ret_682; \
54628 int32x2_t __s0_682 = __p0_682; \
54629 int64x2_t __s1_682 = __p1_682; \
54630 int32x2_t __rev0_682; __rev0_682 = __builtin_shufflevector(__s0_682, __s0_682, 1, 0); \
54631 int64x2_t __rev1_682; __rev1_682 = __builtin_shufflevector(__s1_682, __s1_682, 1, 0); \
54632 __ret_682 = (int32x4_t)(__noswap_vcombine_s32((int32x2_t)(__rev0_682), (int32x2_t)(__noswap_vqrshrun_n_s64(__rev1_682, __p2_682)))); \
54633 __ret_682 = __builtin_shufflevector(__ret_682, __ret_682, 3, 2, 1, 0); \
54634 __ret_682; \
5301454635})
5301554636#endif
5301654637
5301754638#ifdef __LITTLE_ENDIAN__
53018#define vfma_laneq_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
53019 float32x2_t __ret; \
53020 float32x2_t __s0 = __p0; \
53021 float32x2_t __s1 = __p1; \
53022 float32x4_t __s2 = __p2; \
53023 __ret = (float32x2_t) __builtin_neon_vfma_laneq_v((int8x8_t)__s0, (int8x8_t)__s1, (int8x16_t)__s2, __p3, 9); \
53024 __ret; \
54639#define vqrshrun_high_n_s16(__p0_683, __p1_683, __p2_683) __extension__ ({ \
54640 int8x16_t __ret_683; \
54641 int8x8_t __s0_683 = __p0_683; \
54642 int16x8_t __s1_683 = __p1_683; \
54643 __ret_683 = (int8x16_t)(vcombine_s8((int8x8_t)(__s0_683), (int8x8_t)(vqrshrun_n_s16(__s1_683, __p2_683)))); \
54644 __ret_683; \
5302554645})
5302654646#else
53027#define vfma_laneq_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
53028 float32x2_t __ret; \
53029 float32x2_t __s0 = __p0; \
53030 float32x2_t __s1 = __p1; \
53031 float32x4_t __s2 = __p2; \
53032 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
53033 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
53034 float32x4_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 3, 2, 1, 0); \
53035 __ret = (float32x2_t) __builtin_neon_vfma_laneq_v((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x16_t)__rev2, __p3, 9); \
53036 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
54647#define vqrshrun_high_n_s16(__p0_684, __p1_684, __p2_684) __extension__ ({ \
54648 int8x16_t __ret_684; \
54649 int8x8_t __s0_684 = __p0_684; \
54650 int16x8_t __s1_684 = __p1_684; \
54651 int8x8_t __rev0_684; __rev0_684 = __builtin_shufflevector(__s0_684, __s0_684, 7, 6, 5, 4, 3, 2, 1, 0); \
54652 int16x8_t __rev1_684; __rev1_684 = __builtin_shufflevector(__s1_684, __s1_684, 7, 6, 5, 4, 3, 2, 1, 0); \
54653 __ret_684 = (int8x16_t)(__noswap_vcombine_s8((int8x8_t)(__rev0_684), (int8x8_t)(__noswap_vqrshrun_n_s16(__rev1_684, __p2_684)))); \
54654 __ret_684 = __builtin_shufflevector(__ret_684, __ret_684, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54655 __ret_684; \
54656})
54657#endif
54658
54659#define vqrshruns_n_s32(__p0, __p1) __extension__ ({ \
54660 int16_t __ret; \
54661 int32_t __s0 = __p0; \
54662 __ret = (int16_t) __builtin_neon_vqrshruns_n_s32(__s0, __p1); \
5303754663 __ret; \
5303854664})
53039#define __noswap_vfma_laneq_f32(__p0, __p1, __p2, __p3) __extension__ ({ \
53040 float32x2_t __ret; \
53041 float32x2_t __s0 = __p0; \
53042 float32x2_t __s1 = __p1; \
53043 float32x4_t __s2 = __p2; \
53044 __ret = (float32x2_t) __builtin_neon_vfma_laneq_v((int8x8_t)__s0, (int8x8_t)__s1, (int8x16_t)__s2, __p3, 9); \
54665#define vqrshrund_n_s64(__p0, __p1) __extension__ ({ \
54666 int32_t __ret; \
54667 int64_t __s0 = __p0; \
54668 __ret = (int32_t) __builtin_neon_vqrshrund_n_s64(__s0, __p1); \
5304554669 __ret; \
5304654670})
53047#endif
53048
53049#ifdef __LITTLE_ENDIAN__
53050__ai float64x2_t vfmaq_n_f64(float64x2_t __p0, float64x2_t __p1, float64_t __p2) {
53051 float64x2_t __ret;
53052 __ret = vfmaq_f64(__p0, __p1, (float64x2_t) {__p2, __p2});
54671#define vqrshrunh_n_s16(__p0, __p1) __extension__ ({ \
54672 int8_t __ret; \
54673 int16_t __s0 = __p0; \
54674 __ret = (int8_t) __builtin_neon_vqrshrunh_n_s16(__s0, __p1); \
54675 __ret; \
54676})
54677__ai uint8_t vqshlb_u8(uint8_t __p0, int8_t __p1) {
54678 uint8_t __ret;
54679 __ret = (uint8_t) __builtin_neon_vqshlb_u8(__p0, __p1);
5305354680 return __ret;
5305454681}
53055#else
53056__ai float64x2_t vfmaq_n_f64(float64x2_t __p0, float64x2_t __p1, float64_t __p2) {
53057 float64x2_t __ret;
53058 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
53059 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
53060 __ret = __noswap_vfmaq_f64(__rev0, __rev1, (float64x2_t) {__p2, __p2});
53061 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
54682__ai uint32_t vqshls_u32(uint32_t __p0, int32_t __p1) {
54683 uint32_t __ret;
54684 __ret = (uint32_t) __builtin_neon_vqshls_u32(__p0, __p1);
5306254685 return __ret;
5306354686}
53064#endif
53065
53066__ai float64x1_t vfma_n_f64(float64x1_t __p0, float64x1_t __p1, float64_t __p2) {
53067 float64x1_t __ret;
53068 __ret = vfma_f64(__p0, __p1, (float64x1_t) {__p2});
54687__ai uint64_t vqshld_u64(uint64_t __p0, int64_t __p1) {
54688 uint64_t __ret;
54689 __ret = (uint64_t) __builtin_neon_vqshld_u64(__p0, __p1);
5306954690 return __ret;
5307054691}
53071#ifdef __LITTLE_ENDIAN__
53072__ai float64x2_t vfmsq_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
53073 float64x2_t __ret;
53074 __ret = vfmaq_f64(__p0, -__p1, __p2);
54692__ai uint16_t vqshlh_u16(uint16_t __p0, int16_t __p1) {
54693 uint16_t __ret;
54694 __ret = (uint16_t) __builtin_neon_vqshlh_u16(__p0, __p1);
5307554695 return __ret;
5307654696}
53077#else
53078__ai float64x2_t vfmsq_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
53079 float64x2_t __ret;
53080 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
53081 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
53082 float64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
53083 __ret = __noswap_vfmaq_f64(__rev0, -__rev1, __rev2);
53084 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
54697__ai int8_t vqshlb_s8(int8_t __p0, int8_t __p1) {
54698 int8_t __ret;
54699 __ret = (int8_t) __builtin_neon_vqshlb_s8(__p0, __p1);
5308554700 return __ret;
5308654701}
53087#endif
53088
53089__ai float64x1_t vfms_f64(float64x1_t __p0, float64x1_t __p1, float64x1_t __p2) {
53090 float64x1_t __ret;
53091 __ret = vfma_f64(__p0, -__p1, __p2);
54702__ai int32_t vqshls_s32(int32_t __p0, int32_t __p1) {
54703 int32_t __ret;
54704 __ret = (int32_t) __builtin_neon_vqshls_s32(__p0, __p1);
5309254705 return __ret;
5309354706}
53094#define vfmsd_lane_f64(__p0_509, __p1_509, __p2_509, __p3_509) __extension__ ({ \
53095 float64_t __ret_509; \
53096 float64_t __s0_509 = __p0_509; \
53097 float64_t __s1_509 = __p1_509; \
53098 float64x1_t __s2_509 = __p2_509; \
53099 __ret_509 = vfmad_lane_f64(__s0_509, -__s1_509, __s2_509, __p3_509); \
53100 __ret_509; \
54707__ai int64_t vqshld_s64(int64_t __p0, int64_t __p1) {
54708 int64_t __ret;
54709 __ret = (int64_t) __builtin_neon_vqshld_s64(__p0, __p1);
54710 return __ret;
54711}
54712__ai int16_t vqshlh_s16(int16_t __p0, int16_t __p1) {
54713 int16_t __ret;
54714 __ret = (int16_t) __builtin_neon_vqshlh_s16(__p0, __p1);
54715 return __ret;
54716}
54717#define vqshlb_n_u8(__p0, __p1) __extension__ ({ \
54718 uint8_t __ret; \
54719 uint8_t __s0 = __p0; \
54720 __ret = (uint8_t) __builtin_neon_vqshlb_n_u8(__s0, __p1); \
54721 __ret; \
5310154722})
53102#ifdef __LITTLE_ENDIAN__
53103#define vfmss_lane_f32(__p0_510, __p1_510, __p2_510, __p3_510) __extension__ ({ \
53104 float32_t __ret_510; \
53105 float32_t __s0_510 = __p0_510; \
53106 float32_t __s1_510 = __p1_510; \
53107 float32x2_t __s2_510 = __p2_510; \
53108 __ret_510 = vfmas_lane_f32(__s0_510, -__s1_510, __s2_510, __p3_510); \
53109 __ret_510; \
54723#define vqshls_n_u32(__p0, __p1) __extension__ ({ \
54724 uint32_t __ret; \
54725 uint32_t __s0 = __p0; \
54726 __ret = (uint32_t) __builtin_neon_vqshls_n_u32(__s0, __p1); \
54727 __ret; \
5311054728})
53111#else
53112#define vfmss_lane_f32(__p0_511, __p1_511, __p2_511, __p3_511) __extension__ ({ \
53113 float32_t __ret_511; \
53114 float32_t __s0_511 = __p0_511; \
53115 float32_t __s1_511 = __p1_511; \
53116 float32x2_t __s2_511 = __p2_511; \
53117 float32x2_t __rev2_511; __rev2_511 = __builtin_shufflevector(__s2_511, __s2_511, 1, 0); \
53118 __ret_511 = __noswap_vfmas_lane_f32(__s0_511, -__s1_511, __rev2_511, __p3_511); \
53119 __ret_511; \
54729#define vqshld_n_u64(__p0, __p1) __extension__ ({ \
54730 uint64_t __ret; \
54731 uint64_t __s0 = __p0; \
54732 __ret = (uint64_t) __builtin_neon_vqshld_n_u64(__s0, __p1); \
54733 __ret; \
54734})
54735#define vqshlh_n_u16(__p0, __p1) __extension__ ({ \
54736 uint16_t __ret; \
54737 uint16_t __s0 = __p0; \
54738 __ret = (uint16_t) __builtin_neon_vqshlh_n_u16(__s0, __p1); \
54739 __ret; \
54740})
54741#define vqshlb_n_s8(__p0, __p1) __extension__ ({ \
54742 int8_t __ret; \
54743 int8_t __s0 = __p0; \
54744 __ret = (int8_t) __builtin_neon_vqshlb_n_s8(__s0, __p1); \
54745 __ret; \
54746})
54747#define vqshls_n_s32(__p0, __p1) __extension__ ({ \
54748 int32_t __ret; \
54749 int32_t __s0 = __p0; \
54750 __ret = (int32_t) __builtin_neon_vqshls_n_s32(__s0, __p1); \
54751 __ret; \
54752})
54753#define vqshld_n_s64(__p0, __p1) __extension__ ({ \
54754 int64_t __ret; \
54755 int64_t __s0 = __p0; \
54756 __ret = (int64_t) __builtin_neon_vqshld_n_s64(__s0, __p1); \
54757 __ret; \
54758})
54759#define vqshlh_n_s16(__p0, __p1) __extension__ ({ \
54760 int16_t __ret; \
54761 int16_t __s0 = __p0; \
54762 __ret = (int16_t) __builtin_neon_vqshlh_n_s16(__s0, __p1); \
54763 __ret; \
54764})
54765#define vqshlub_n_s8(__p0, __p1) __extension__ ({ \
54766 int8_t __ret; \
54767 int8_t __s0 = __p0; \
54768 __ret = (int8_t) __builtin_neon_vqshlub_n_s8(__s0, __p1); \
54769 __ret; \
54770})
54771#define vqshlus_n_s32(__p0, __p1) __extension__ ({ \
54772 int32_t __ret; \
54773 int32_t __s0 = __p0; \
54774 __ret = (int32_t) __builtin_neon_vqshlus_n_s32(__s0, __p1); \
54775 __ret; \
54776})
54777#define vqshlud_n_s64(__p0, __p1) __extension__ ({ \
54778 int64_t __ret; \
54779 int64_t __s0 = __p0; \
54780 __ret = (int64_t) __builtin_neon_vqshlud_n_s64(__s0, __p1); \
54781 __ret; \
54782})
54783#define vqshluh_n_s16(__p0, __p1) __extension__ ({ \
54784 int16_t __ret; \
54785 int16_t __s0 = __p0; \
54786 __ret = (int16_t) __builtin_neon_vqshluh_n_s16(__s0, __p1); \
54787 __ret; \
5312054788})
53121#endif
53122
5312354789#ifdef __LITTLE_ENDIAN__
53124#define vfmsq_lane_f64(__p0_512, __p1_512, __p2_512, __p3_512) __extension__ ({ \
53125 float64x2_t __ret_512; \
53126 float64x2_t __s0_512 = __p0_512; \
53127 float64x2_t __s1_512 = __p1_512; \
53128 float64x1_t __s2_512 = __p2_512; \
53129 __ret_512 = vfmaq_lane_f64(__s0_512, -__s1_512, __s2_512, __p3_512); \
53130 __ret_512; \
54790#define vqshrn_high_n_u32(__p0_685, __p1_685, __p2_685) __extension__ ({ \
54791 uint16x8_t __ret_685; \
54792 uint16x4_t __s0_685 = __p0_685; \
54793 uint32x4_t __s1_685 = __p1_685; \
54794 __ret_685 = (uint16x8_t)(vcombine_u16((uint16x4_t)(__s0_685), (uint16x4_t)(vqshrn_n_u32(__s1_685, __p2_685)))); \
54795 __ret_685; \
5313154796})
5313254797#else
53133#define vfmsq_lane_f64(__p0_513, __p1_513, __p2_513, __p3_513) __extension__ ({ \
53134 float64x2_t __ret_513; \
53135 float64x2_t __s0_513 = __p0_513; \
53136 float64x2_t __s1_513 = __p1_513; \
53137 float64x1_t __s2_513 = __p2_513; \
53138 float64x2_t __rev0_513; __rev0_513 = __builtin_shufflevector(__s0_513, __s0_513, 1, 0); \
53139 float64x2_t __rev1_513; __rev1_513 = __builtin_shufflevector(__s1_513, __s1_513, 1, 0); \
53140 __ret_513 = __noswap_vfmaq_lane_f64(__rev0_513, -__rev1_513, __s2_513, __p3_513); \
53141 __ret_513 = __builtin_shufflevector(__ret_513, __ret_513, 1, 0); \
53142 __ret_513; \
54798#define vqshrn_high_n_u32(__p0_686, __p1_686, __p2_686) __extension__ ({ \
54799 uint16x8_t __ret_686; \
54800 uint16x4_t __s0_686 = __p0_686; \
54801 uint32x4_t __s1_686 = __p1_686; \
54802 uint16x4_t __rev0_686; __rev0_686 = __builtin_shufflevector(__s0_686, __s0_686, 3, 2, 1, 0); \
54803 uint32x4_t __rev1_686; __rev1_686 = __builtin_shufflevector(__s1_686, __s1_686, 3, 2, 1, 0); \
54804 __ret_686 = (uint16x8_t)(__noswap_vcombine_u16((uint16x4_t)(__rev0_686), (uint16x4_t)(__noswap_vqshrn_n_u32(__rev1_686, __p2_686)))); \
54805 __ret_686 = __builtin_shufflevector(__ret_686, __ret_686, 7, 6, 5, 4, 3, 2, 1, 0); \
54806 __ret_686; \
5314354807})
5314454808#endif
5314554809
5314654810#ifdef __LITTLE_ENDIAN__
53147#define vfmsq_lane_f32(__p0_514, __p1_514, __p2_514, __p3_514) __extension__ ({ \
53148 float32x4_t __ret_514; \
53149 float32x4_t __s0_514 = __p0_514; \
53150 float32x4_t __s1_514 = __p1_514; \
53151 float32x2_t __s2_514 = __p2_514; \
53152 __ret_514 = vfmaq_lane_f32(__s0_514, -__s1_514, __s2_514, __p3_514); \
53153 __ret_514; \
54811#define vqshrn_high_n_u64(__p0_687, __p1_687, __p2_687) __extension__ ({ \
54812 uint32x4_t __ret_687; \
54813 uint32x2_t __s0_687 = __p0_687; \
54814 uint64x2_t __s1_687 = __p1_687; \
54815 __ret_687 = (uint32x4_t)(vcombine_u32((uint32x2_t)(__s0_687), (uint32x2_t)(vqshrn_n_u64(__s1_687, __p2_687)))); \
54816 __ret_687; \
5315454817})
5315554818#else
53156#define vfmsq_lane_f32(__p0_515, __p1_515, __p2_515, __p3_515) __extension__ ({ \
53157 float32x4_t __ret_515; \
53158 float32x4_t __s0_515 = __p0_515; \
53159 float32x4_t __s1_515 = __p1_515; \
53160 float32x2_t __s2_515 = __p2_515; \
53161 float32x4_t __rev0_515; __rev0_515 = __builtin_shufflevector(__s0_515, __s0_515, 3, 2, 1, 0); \
53162 float32x4_t __rev1_515; __rev1_515 = __builtin_shufflevector(__s1_515, __s1_515, 3, 2, 1, 0); \
53163 float32x2_t __rev2_515; __rev2_515 = __builtin_shufflevector(__s2_515, __s2_515, 1, 0); \
53164 __ret_515 = __noswap_vfmaq_lane_f32(__rev0_515, -__rev1_515, __rev2_515, __p3_515); \
53165 __ret_515 = __builtin_shufflevector(__ret_515, __ret_515, 3, 2, 1, 0); \
53166 __ret_515; \
54819#define vqshrn_high_n_u64(__p0_688, __p1_688, __p2_688) __extension__ ({ \
54820 uint32x4_t __ret_688; \
54821 uint32x2_t __s0_688 = __p0_688; \
54822 uint64x2_t __s1_688 = __p1_688; \
54823 uint32x2_t __rev0_688; __rev0_688 = __builtin_shufflevector(__s0_688, __s0_688, 1, 0); \
54824 uint64x2_t __rev1_688; __rev1_688 = __builtin_shufflevector(__s1_688, __s1_688, 1, 0); \
54825 __ret_688 = (uint32x4_t)(__noswap_vcombine_u32((uint32x2_t)(__rev0_688), (uint32x2_t)(__noswap_vqshrn_n_u64(__rev1_688, __p2_688)))); \
54826 __ret_688 = __builtin_shufflevector(__ret_688, __ret_688, 3, 2, 1, 0); \
54827 __ret_688; \
5316754828})
5316854829#endif
5316954830
53170#define vfms_lane_f64(__p0_516, __p1_516, __p2_516, __p3_516) __extension__ ({ \
53171 float64x1_t __ret_516; \
53172 float64x1_t __s0_516 = __p0_516; \
53173 float64x1_t __s1_516 = __p1_516; \
53174 float64x1_t __s2_516 = __p2_516; \
53175 __ret_516 = vfma_lane_f64(__s0_516, -__s1_516, __s2_516, __p3_516); \
53176 __ret_516; \
53177})
5317854831#ifdef __LITTLE_ENDIAN__
53179#define vfms_lane_f32(__p0_517, __p1_517, __p2_517, __p3_517) __extension__ ({ \
53180 float32x2_t __ret_517; \
53181 float32x2_t __s0_517 = __p0_517; \
53182 float32x2_t __s1_517 = __p1_517; \
53183 float32x2_t __s2_517 = __p2_517; \
53184 __ret_517 = vfma_lane_f32(__s0_517, -__s1_517, __s2_517, __p3_517); \
53185 __ret_517; \
54832#define vqshrn_high_n_u16(__p0_689, __p1_689, __p2_689) __extension__ ({ \
54833 uint8x16_t __ret_689; \
54834 uint8x8_t __s0_689 = __p0_689; \
54835 uint16x8_t __s1_689 = __p1_689; \
54836 __ret_689 = (uint8x16_t)(vcombine_u8((uint8x8_t)(__s0_689), (uint8x8_t)(vqshrn_n_u16(__s1_689, __p2_689)))); \
54837 __ret_689; \
5318654838})
5318754839#else
53188#define vfms_lane_f32(__p0_518, __p1_518, __p2_518, __p3_518) __extension__ ({ \
53189 float32x2_t __ret_518; \
53190 float32x2_t __s0_518 = __p0_518; \
53191 float32x2_t __s1_518 = __p1_518; \
53192 float32x2_t __s2_518 = __p2_518; \
53193 float32x2_t __rev0_518; __rev0_518 = __builtin_shufflevector(__s0_518, __s0_518, 1, 0); \
53194 float32x2_t __rev1_518; __rev1_518 = __builtin_shufflevector(__s1_518, __s1_518, 1, 0); \
53195 float32x2_t __rev2_518; __rev2_518 = __builtin_shufflevector(__s2_518, __s2_518, 1, 0); \
53196 __ret_518 = __noswap_vfma_lane_f32(__rev0_518, -__rev1_518, __rev2_518, __p3_518); \
53197 __ret_518 = __builtin_shufflevector(__ret_518, __ret_518, 1, 0); \
53198 __ret_518; \
54840#define vqshrn_high_n_u16(__p0_690, __p1_690, __p2_690) __extension__ ({ \
54841 uint8x16_t __ret_690; \
54842 uint8x8_t __s0_690 = __p0_690; \
54843 uint16x8_t __s1_690 = __p1_690; \
54844 uint8x8_t __rev0_690; __rev0_690 = __builtin_shufflevector(__s0_690, __s0_690, 7, 6, 5, 4, 3, 2, 1, 0); \
54845 uint16x8_t __rev1_690; __rev1_690 = __builtin_shufflevector(__s1_690, __s1_690, 7, 6, 5, 4, 3, 2, 1, 0); \
54846 __ret_690 = (uint8x16_t)(__noswap_vcombine_u8((uint8x8_t)(__rev0_690), (uint8x8_t)(__noswap_vqshrn_n_u16(__rev1_690, __p2_690)))); \
54847 __ret_690 = __builtin_shufflevector(__ret_690, __ret_690, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54848 __ret_690; \
5319954849})
5320054850#endif
5320154851
5320254852#ifdef __LITTLE_ENDIAN__
53203#define vfmsd_laneq_f64(__p0_519, __p1_519, __p2_519, __p3_519) __extension__ ({ \
53204 float64_t __ret_519; \
53205 float64_t __s0_519 = __p0_519; \
53206 float64_t __s1_519 = __p1_519; \
53207 float64x2_t __s2_519 = __p2_519; \
53208 __ret_519 = vfmad_laneq_f64(__s0_519, -__s1_519, __s2_519, __p3_519); \
53209 __ret_519; \
54853#define vqshrn_high_n_s32(__p0_691, __p1_691, __p2_691) __extension__ ({ \
54854 int16x8_t __ret_691; \
54855 int16x4_t __s0_691 = __p0_691; \
54856 int32x4_t __s1_691 = __p1_691; \
54857 __ret_691 = (int16x8_t)(vcombine_s16((int16x4_t)(__s0_691), (int16x4_t)(vqshrn_n_s32(__s1_691, __p2_691)))); \
54858 __ret_691; \
5321054859})
5321154860#else
53212#define vfmsd_laneq_f64(__p0_520, __p1_520, __p2_520, __p3_520) __extension__ ({ \
53213 float64_t __ret_520; \
53214 float64_t __s0_520 = __p0_520; \
53215 float64_t __s1_520 = __p1_520; \
53216 float64x2_t __s2_520 = __p2_520; \
53217 float64x2_t __rev2_520; __rev2_520 = __builtin_shufflevector(__s2_520, __s2_520, 1, 0); \
53218 __ret_520 = __noswap_vfmad_laneq_f64(__s0_520, -__s1_520, __rev2_520, __p3_520); \
53219 __ret_520; \
54861#define vqshrn_high_n_s32(__p0_692, __p1_692, __p2_692) __extension__ ({ \
54862 int16x8_t __ret_692; \
54863 int16x4_t __s0_692 = __p0_692; \
54864 int32x4_t __s1_692 = __p1_692; \
54865 int16x4_t __rev0_692; __rev0_692 = __builtin_shufflevector(__s0_692, __s0_692, 3, 2, 1, 0); \
54866 int32x4_t __rev1_692; __rev1_692 = __builtin_shufflevector(__s1_692, __s1_692, 3, 2, 1, 0); \
54867 __ret_692 = (int16x8_t)(__noswap_vcombine_s16((int16x4_t)(__rev0_692), (int16x4_t)(__noswap_vqshrn_n_s32(__rev1_692, __p2_692)))); \
54868 __ret_692 = __builtin_shufflevector(__ret_692, __ret_692, 7, 6, 5, 4, 3, 2, 1, 0); \
54869 __ret_692; \
5322054870})
5322154871#endif
5322254872
5322354873#ifdef __LITTLE_ENDIAN__
53224#define vfmss_laneq_f32(__p0_521, __p1_521, __p2_521, __p3_521) __extension__ ({ \
53225 float32_t __ret_521; \
53226 float32_t __s0_521 = __p0_521; \
53227 float32_t __s1_521 = __p1_521; \
53228 float32x4_t __s2_521 = __p2_521; \
53229 __ret_521 = vfmas_laneq_f32(__s0_521, -__s1_521, __s2_521, __p3_521); \
53230 __ret_521; \
54874#define vqshrn_high_n_s64(__p0_693, __p1_693, __p2_693) __extension__ ({ \
54875 int32x4_t __ret_693; \
54876 int32x2_t __s0_693 = __p0_693; \
54877 int64x2_t __s1_693 = __p1_693; \
54878 __ret_693 = (int32x4_t)(vcombine_s32((int32x2_t)(__s0_693), (int32x2_t)(vqshrn_n_s64(__s1_693, __p2_693)))); \
54879 __ret_693; \
5323154880})
5323254881#else
53233#define vfmss_laneq_f32(__p0_522, __p1_522, __p2_522, __p3_522) __extension__ ({ \
53234 float32_t __ret_522; \
53235 float32_t __s0_522 = __p0_522; \
53236 float32_t __s1_522 = __p1_522; \
53237 float32x4_t __s2_522 = __p2_522; \
53238 float32x4_t __rev2_522; __rev2_522 = __builtin_shufflevector(__s2_522, __s2_522, 3, 2, 1, 0); \
53239 __ret_522 = __noswap_vfmas_laneq_f32(__s0_522, -__s1_522, __rev2_522, __p3_522); \
53240 __ret_522; \
54882#define vqshrn_high_n_s64(__p0_694, __p1_694, __p2_694) __extension__ ({ \
54883 int32x4_t __ret_694; \
54884 int32x2_t __s0_694 = __p0_694; \
54885 int64x2_t __s1_694 = __p1_694; \
54886 int32x2_t __rev0_694; __rev0_694 = __builtin_shufflevector(__s0_694, __s0_694, 1, 0); \
54887 int64x2_t __rev1_694; __rev1_694 = __builtin_shufflevector(__s1_694, __s1_694, 1, 0); \
54888 __ret_694 = (int32x4_t)(__noswap_vcombine_s32((int32x2_t)(__rev0_694), (int32x2_t)(__noswap_vqshrn_n_s64(__rev1_694, __p2_694)))); \
54889 __ret_694 = __builtin_shufflevector(__ret_694, __ret_694, 3, 2, 1, 0); \
54890 __ret_694; \
5324154891})
5324254892#endif
5324354893
5324454894#ifdef __LITTLE_ENDIAN__
53245#define vfmsq_laneq_f64(__p0_523, __p1_523, __p2_523, __p3_523) __extension__ ({ \
53246 float64x2_t __ret_523; \
53247 float64x2_t __s0_523 = __p0_523; \
53248 float64x2_t __s1_523 = __p1_523; \
53249 float64x2_t __s2_523 = __p2_523; \
53250 __ret_523 = vfmaq_laneq_f64(__s0_523, -__s1_523, __s2_523, __p3_523); \
53251 __ret_523; \
54895#define vqshrn_high_n_s16(__p0_695, __p1_695, __p2_695) __extension__ ({ \
54896 int8x16_t __ret_695; \
54897 int8x8_t __s0_695 = __p0_695; \
54898 int16x8_t __s1_695 = __p1_695; \
54899 __ret_695 = (int8x16_t)(vcombine_s8((int8x8_t)(__s0_695), (int8x8_t)(vqshrn_n_s16(__s1_695, __p2_695)))); \
54900 __ret_695; \
5325254901})
5325354902#else
53254#define vfmsq_laneq_f64(__p0_524, __p1_524, __p2_524, __p3_524) __extension__ ({ \
53255 float64x2_t __ret_524; \
53256 float64x2_t __s0_524 = __p0_524; \
53257 float64x2_t __s1_524 = __p1_524; \
53258 float64x2_t __s2_524 = __p2_524; \
53259 float64x2_t __rev0_524; __rev0_524 = __builtin_shufflevector(__s0_524, __s0_524, 1, 0); \
53260 float64x2_t __rev1_524; __rev1_524 = __builtin_shufflevector(__s1_524, __s1_524, 1, 0); \
53261 float64x2_t __rev2_524; __rev2_524 = __builtin_shufflevector(__s2_524, __s2_524, 1, 0); \
53262 __ret_524 = __noswap_vfmaq_laneq_f64(__rev0_524, -__rev1_524, __rev2_524, __p3_524); \
53263 __ret_524 = __builtin_shufflevector(__ret_524, __ret_524, 1, 0); \
53264 __ret_524; \
54903#define vqshrn_high_n_s16(__p0_696, __p1_696, __p2_696) __extension__ ({ \
54904 int8x16_t __ret_696; \
54905 int8x8_t __s0_696 = __p0_696; \
54906 int16x8_t __s1_696 = __p1_696; \
54907 int8x8_t __rev0_696; __rev0_696 = __builtin_shufflevector(__s0_696, __s0_696, 7, 6, 5, 4, 3, 2, 1, 0); \
54908 int16x8_t __rev1_696; __rev1_696 = __builtin_shufflevector(__s1_696, __s1_696, 7, 6, 5, 4, 3, 2, 1, 0); \
54909 __ret_696 = (int8x16_t)(__noswap_vcombine_s8((int8x8_t)(__rev0_696), (int8x8_t)(__noswap_vqshrn_n_s16(__rev1_696, __p2_696)))); \
54910 __ret_696 = __builtin_shufflevector(__ret_696, __ret_696, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54911 __ret_696; \
5326554912})
5326654913#endif
5326754914
54915#define vqshrns_n_u32(__p0, __p1) __extension__ ({ \
54916 uint16_t __ret; \
54917 uint32_t __s0 = __p0; \
54918 __ret = (uint16_t) __builtin_neon_vqshrns_n_u32(__s0, __p1); \
54919 __ret; \
54920})
54921#define vqshrnd_n_u64(__p0, __p1) __extension__ ({ \
54922 uint32_t __ret; \
54923 uint64_t __s0 = __p0; \
54924 __ret = (uint32_t) __builtin_neon_vqshrnd_n_u64(__s0, __p1); \
54925 __ret; \
54926})
54927#define vqshrnh_n_u16(__p0, __p1) __extension__ ({ \
54928 uint8_t __ret; \
54929 uint16_t __s0 = __p0; \
54930 __ret = (uint8_t) __builtin_neon_vqshrnh_n_u16(__s0, __p1); \
54931 __ret; \
54932})
54933#define vqshrns_n_s32(__p0, __p1) __extension__ ({ \
54934 int16_t __ret; \
54935 int32_t __s0 = __p0; \
54936 __ret = (int16_t) __builtin_neon_vqshrns_n_s32(__s0, __p1); \
54937 __ret; \
54938})
54939#define vqshrnd_n_s64(__p0, __p1) __extension__ ({ \
54940 int32_t __ret; \
54941 int64_t __s0 = __p0; \
54942 __ret = (int32_t) __builtin_neon_vqshrnd_n_s64(__s0, __p1); \
54943 __ret; \
54944})
54945#define vqshrnh_n_s16(__p0, __p1) __extension__ ({ \
54946 int8_t __ret; \
54947 int16_t __s0 = __p0; \
54948 __ret = (int8_t) __builtin_neon_vqshrnh_n_s16(__s0, __p1); \
54949 __ret; \
54950})
5326854951#ifdef __LITTLE_ENDIAN__
53269#define vfmsq_laneq_f32(__p0_525, __p1_525, __p2_525, __p3_525) __extension__ ({ \
53270 float32x4_t __ret_525; \
53271 float32x4_t __s0_525 = __p0_525; \
53272 float32x4_t __s1_525 = __p1_525; \
53273 float32x4_t __s2_525 = __p2_525; \
53274 __ret_525 = vfmaq_laneq_f32(__s0_525, -__s1_525, __s2_525, __p3_525); \
53275 __ret_525; \
54952#define vqshrun_high_n_s32(__p0_697, __p1_697, __p2_697) __extension__ ({ \
54953 int16x8_t __ret_697; \
54954 int16x4_t __s0_697 = __p0_697; \
54955 int32x4_t __s1_697 = __p1_697; \
54956 __ret_697 = (int16x8_t)(vcombine_s16((int16x4_t)(__s0_697), (int16x4_t)(vqshrun_n_s32(__s1_697, __p2_697)))); \
54957 __ret_697; \
5327654958})
5327754959#else
53278#define vfmsq_laneq_f32(__p0_526, __p1_526, __p2_526, __p3_526) __extension__ ({ \
53279 float32x4_t __ret_526; \
53280 float32x4_t __s0_526 = __p0_526; \
53281 float32x4_t __s1_526 = __p1_526; \
53282 float32x4_t __s2_526 = __p2_526; \
53283 float32x4_t __rev0_526; __rev0_526 = __builtin_shufflevector(__s0_526, __s0_526, 3, 2, 1, 0); \
53284 float32x4_t __rev1_526; __rev1_526 = __builtin_shufflevector(__s1_526, __s1_526, 3, 2, 1, 0); \
53285 float32x4_t __rev2_526; __rev2_526 = __builtin_shufflevector(__s2_526, __s2_526, 3, 2, 1, 0); \
53286 __ret_526 = __noswap_vfmaq_laneq_f32(__rev0_526, -__rev1_526, __rev2_526, __p3_526); \
53287 __ret_526 = __builtin_shufflevector(__ret_526, __ret_526, 3, 2, 1, 0); \
53288 __ret_526; \
54960#define vqshrun_high_n_s32(__p0_698, __p1_698, __p2_698) __extension__ ({ \
54961 int16x8_t __ret_698; \
54962 int16x4_t __s0_698 = __p0_698; \
54963 int32x4_t __s1_698 = __p1_698; \
54964 int16x4_t __rev0_698; __rev0_698 = __builtin_shufflevector(__s0_698, __s0_698, 3, 2, 1, 0); \
54965 int32x4_t __rev1_698; __rev1_698 = __builtin_shufflevector(__s1_698, __s1_698, 3, 2, 1, 0); \
54966 __ret_698 = (int16x8_t)(__noswap_vcombine_s16((int16x4_t)(__rev0_698), (int16x4_t)(__noswap_vqshrun_n_s32(__rev1_698, __p2_698)))); \
54967 __ret_698 = __builtin_shufflevector(__ret_698, __ret_698, 7, 6, 5, 4, 3, 2, 1, 0); \
54968 __ret_698; \
5328954969})
5329054970#endif
5329154971
5329254972#ifdef __LITTLE_ENDIAN__
53293#define vfms_laneq_f64(__p0_527, __p1_527, __p2_527, __p3_527) __extension__ ({ \
53294 float64x1_t __ret_527; \
53295 float64x1_t __s0_527 = __p0_527; \
53296 float64x1_t __s1_527 = __p1_527; \
53297 float64x2_t __s2_527 = __p2_527; \
53298 __ret_527 = vfma_laneq_f64(__s0_527, -__s1_527, __s2_527, __p3_527); \
53299 __ret_527; \
54973#define vqshrun_high_n_s64(__p0_699, __p1_699, __p2_699) __extension__ ({ \
54974 int32x4_t __ret_699; \
54975 int32x2_t __s0_699 = __p0_699; \
54976 int64x2_t __s1_699 = __p1_699; \
54977 __ret_699 = (int32x4_t)(vcombine_s32((int32x2_t)(__s0_699), (int32x2_t)(vqshrun_n_s64(__s1_699, __p2_699)))); \
54978 __ret_699; \
5330054979})
5330154980#else
53302#define vfms_laneq_f64(__p0_528, __p1_528, __p2_528, __p3_528) __extension__ ({ \
53303 float64x1_t __ret_528; \
53304 float64x1_t __s0_528 = __p0_528; \
53305 float64x1_t __s1_528 = __p1_528; \
53306 float64x2_t __s2_528 = __p2_528; \
53307 float64x2_t __rev2_528; __rev2_528 = __builtin_shufflevector(__s2_528, __s2_528, 1, 0); \
53308 __ret_528 = __noswap_vfma_laneq_f64(__s0_528, -__s1_528, __rev2_528, __p3_528); \
53309 __ret_528; \
54981#define vqshrun_high_n_s64(__p0_700, __p1_700, __p2_700) __extension__ ({ \
54982 int32x4_t __ret_700; \
54983 int32x2_t __s0_700 = __p0_700; \
54984 int64x2_t __s1_700 = __p1_700; \
54985 int32x2_t __rev0_700; __rev0_700 = __builtin_shufflevector(__s0_700, __s0_700, 1, 0); \
54986 int64x2_t __rev1_700; __rev1_700 = __builtin_shufflevector(__s1_700, __s1_700, 1, 0); \
54987 __ret_700 = (int32x4_t)(__noswap_vcombine_s32((int32x2_t)(__rev0_700), (int32x2_t)(__noswap_vqshrun_n_s64(__rev1_700, __p2_700)))); \
54988 __ret_700 = __builtin_shufflevector(__ret_700, __ret_700, 3, 2, 1, 0); \
54989 __ret_700; \
5331054990})
5331154991#endif
5331254992
5331354993#ifdef __LITTLE_ENDIAN__
53314#define vfms_laneq_f32(__p0_529, __p1_529, __p2_529, __p3_529) __extension__ ({ \
53315 float32x2_t __ret_529; \
53316 float32x2_t __s0_529 = __p0_529; \
53317 float32x2_t __s1_529 = __p1_529; \
53318 float32x4_t __s2_529 = __p2_529; \
53319 __ret_529 = vfma_laneq_f32(__s0_529, -__s1_529, __s2_529, __p3_529); \
53320 __ret_529; \
54994#define vqshrun_high_n_s16(__p0_701, __p1_701, __p2_701) __extension__ ({ \
54995 int8x16_t __ret_701; \
54996 int8x8_t __s0_701 = __p0_701; \
54997 int16x8_t __s1_701 = __p1_701; \
54998 __ret_701 = (int8x16_t)(vcombine_s8((int8x8_t)(__s0_701), (int8x8_t)(vqshrun_n_s16(__s1_701, __p2_701)))); \
54999 __ret_701; \
5332155000})
5332255001#else
53323#define vfms_laneq_f32(__p0_530, __p1_530, __p2_530, __p3_530) __extension__ ({ \
53324 float32x2_t __ret_530; \
53325 float32x2_t __s0_530 = __p0_530; \
53326 float32x2_t __s1_530 = __p1_530; \
53327 float32x4_t __s2_530 = __p2_530; \
53328 float32x2_t __rev0_530; __rev0_530 = __builtin_shufflevector(__s0_530, __s0_530, 1, 0); \
53329 float32x2_t __rev1_530; __rev1_530 = __builtin_shufflevector(__s1_530, __s1_530, 1, 0); \
53330 float32x4_t __rev2_530; __rev2_530 = __builtin_shufflevector(__s2_530, __s2_530, 3, 2, 1, 0); \
53331 __ret_530 = __noswap_vfma_laneq_f32(__rev0_530, -__rev1_530, __rev2_530, __p3_530); \
53332 __ret_530 = __builtin_shufflevector(__ret_530, __ret_530, 1, 0); \
53333 __ret_530; \
55002#define vqshrun_high_n_s16(__p0_702, __p1_702, __p2_702) __extension__ ({ \
55003 int8x16_t __ret_702; \
55004 int8x8_t __s0_702 = __p0_702; \
55005 int16x8_t __s1_702 = __p1_702; \
55006 int8x8_t __rev0_702; __rev0_702 = __builtin_shufflevector(__s0_702, __s0_702, 7, 6, 5, 4, 3, 2, 1, 0); \
55007 int16x8_t __rev1_702; __rev1_702 = __builtin_shufflevector(__s1_702, __s1_702, 7, 6, 5, 4, 3, 2, 1, 0); \
55008 __ret_702 = (int8x16_t)(__noswap_vcombine_s8((int8x8_t)(__rev0_702), (int8x8_t)(__noswap_vqshrun_n_s16(__rev1_702, __p2_702)))); \
55009 __ret_702 = __builtin_shufflevector(__ret_702, __ret_702, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
55010 __ret_702; \
5333455011})
5333555012#endif
5333655013
55014#define vqshruns_n_s32(__p0, __p1) __extension__ ({ \
55015 int16_t __ret; \
55016 int32_t __s0 = __p0; \
55017 __ret = (int16_t) __builtin_neon_vqshruns_n_s32(__s0, __p1); \
55018 __ret; \
55019})
55020#define vqshrund_n_s64(__p0, __p1) __extension__ ({ \
55021 int32_t __ret; \
55022 int64_t __s0 = __p0; \
55023 __ret = (int32_t) __builtin_neon_vqshrund_n_s64(__s0, __p1); \
55024 __ret; \
55025})
55026#define vqshrunh_n_s16(__p0, __p1) __extension__ ({ \
55027 int8_t __ret; \
55028 int16_t __s0 = __p0; \
55029 __ret = (int8_t) __builtin_neon_vqshrunh_n_s16(__s0, __p1); \
55030 __ret; \
55031})
55032__ai uint8_t vqsubb_u8(uint8_t __p0, uint8_t __p1) {
55033 uint8_t __ret;
55034 __ret = (uint8_t) __builtin_neon_vqsubb_u8(__p0, __p1);
55035 return __ret;
55036}
55037__ai uint32_t vqsubs_u32(uint32_t __p0, uint32_t __p1) {
55038 uint32_t __ret;
55039 __ret = (uint32_t) __builtin_neon_vqsubs_u32(__p0, __p1);
55040 return __ret;
55041}
55042__ai uint64_t vqsubd_u64(uint64_t __p0, uint64_t __p1) {
55043 uint64_t __ret;
55044 __ret = (uint64_t) __builtin_neon_vqsubd_u64(__p0, __p1);
55045 return __ret;
55046}
55047__ai uint16_t vqsubh_u16(uint16_t __p0, uint16_t __p1) {
55048 uint16_t __ret;
55049 __ret = (uint16_t) __builtin_neon_vqsubh_u16(__p0, __p1);
55050 return __ret;
55051}
55052__ai int8_t vqsubb_s8(int8_t __p0, int8_t __p1) {
55053 int8_t __ret;
55054 __ret = (int8_t) __builtin_neon_vqsubb_s8(__p0, __p1);
55055 return __ret;
55056}
55057__ai int32_t vqsubs_s32(int32_t __p0, int32_t __p1) {
55058 int32_t __ret;
55059 __ret = (int32_t) __builtin_neon_vqsubs_s32(__p0, __p1);
55060 return __ret;
55061}
55062__ai int64_t vqsubd_s64(int64_t __p0, int64_t __p1) {
55063 int64_t __ret;
55064 __ret = (int64_t) __builtin_neon_vqsubd_s64(__p0, __p1);
55065 return __ret;
55066}
55067__ai int16_t vqsubh_s16(int16_t __p0, int16_t __p1) {
55068 int16_t __ret;
55069 __ret = (int16_t) __builtin_neon_vqsubh_s16(__p0, __p1);
55070 return __ret;
55071}
5333755072#ifdef __LITTLE_ENDIAN__
53338__ai float64x2_t vfmsq_n_f64(float64x2_t __p0, float64x2_t __p1, float64_t __p2) {
53339 float64x2_t __ret;
53340 __ret = vfmaq_f64(__p0, -__p1, (float64x2_t) {__p2, __p2});
55073__ai poly8x8_t vqtbl1_p8(poly8x16_t __p0, uint8x8_t __p1) {
55074 poly8x8_t __ret;
55075 __ret = (poly8x8_t) __builtin_neon_vqtbl1_v((int8x16_t)__p0, (int8x8_t)__p1, 4);
5334155076 return __ret;
5334255077}
5334355078#else
53344__ai float64x2_t vfmsq_n_f64(float64x2_t __p0, float64x2_t __p1, float64_t __p2) {
53345 float64x2_t __ret;
53346 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
53347 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
53348 __ret = __noswap_vfmaq_f64(__rev0, -__rev1, (float64x2_t) {__p2, __p2});
53349 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
55079__ai poly8x8_t vqtbl1_p8(poly8x16_t __p0, uint8x8_t __p1) {
55080 poly8x8_t __ret;
55081 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55082 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
55083 __ret = (poly8x8_t) __builtin_neon_vqtbl1_v((int8x16_t)__rev0, (int8x8_t)__rev1, 4);
55084 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
5335055085 return __ret;
5335155086}
5335255087#endif
5335355088
5335455089#ifdef __LITTLE_ENDIAN__
53355__ai float32x4_t vfmsq_n_f32(float32x4_t __p0, float32x4_t __p1, float32_t __p2) {
53356 float32x4_t __ret;
53357 __ret = vfmaq_f32(__p0, -__p1, (float32x4_t) {__p2, __p2, __p2, __p2});
55090__ai poly8x16_t vqtbl1q_p8(poly8x16_t __p0, uint8x16_t __p1) {
55091 poly8x16_t __ret;
55092 __ret = (poly8x16_t) __builtin_neon_vqtbl1q_v((int8x16_t)__p0, (int8x16_t)__p1, 36);
5335855093 return __ret;
5335955094}
5336055095#else
53361__ai float32x4_t vfmsq_n_f32(float32x4_t __p0, float32x4_t __p1, float32_t __p2) {
53362 float32x4_t __ret;
53363 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
53364 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
53365 __ret = __noswap_vfmaq_f32(__rev0, -__rev1, (float32x4_t) {__p2, __p2, __p2, __p2});
53366 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
55096__ai poly8x16_t vqtbl1q_p8(poly8x16_t __p0, uint8x16_t __p1) {
55097 poly8x16_t __ret;
55098 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55099 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55100 __ret = (poly8x16_t) __builtin_neon_vqtbl1q_v((int8x16_t)__rev0, (int8x16_t)__rev1, 36);
55101 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
5336755102 return __ret;
5336855103}
5336955104#endif
5337055105
53371__ai float64x1_t vfms_n_f64(float64x1_t __p0, float64x1_t __p1, float64_t __p2) {
53372 float64x1_t __ret;
53373 __ret = vfma_f64(__p0, -__p1, (float64x1_t) {__p2});
53374 return __ret;
53375}
5337655106#ifdef __LITTLE_ENDIAN__
53377__ai float32x2_t vfms_n_f32(float32x2_t __p0, float32x2_t __p1, float32_t __p2) {
53378 float32x2_t __ret;
53379 __ret = vfma_f32(__p0, -__p1, (float32x2_t) {__p2, __p2});
55107__ai uint8x16_t vqtbl1q_u8(uint8x16_t __p0, uint8x16_t __p1) {
55108 uint8x16_t __ret;
55109 __ret = (uint8x16_t) __builtin_neon_vqtbl1q_v((int8x16_t)__p0, (int8x16_t)__p1, 48);
5338055110 return __ret;
5338155111}
5338255112#else
53383__ai float32x2_t vfms_n_f32(float32x2_t __p0, float32x2_t __p1, float32_t __p2) {
53384 float32x2_t __ret;
53385 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
53386 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
53387 __ret = __noswap_vfma_f32(__rev0, -__rev1, (float32x2_t) {__p2, __p2});
53388 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
55113__ai uint8x16_t vqtbl1q_u8(uint8x16_t __p0, uint8x16_t __p1) {
55114 uint8x16_t __ret;
55115 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55116 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55117 __ret = (uint8x16_t) __builtin_neon_vqtbl1q_v((int8x16_t)__rev0, (int8x16_t)__rev1, 48);
55118 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
5338955119 return __ret;
5339055120}
5339155121#endif
5339255122
5339355123#ifdef __LITTLE_ENDIAN__
53394__ai poly64x1_t vget_high_p64(poly64x2_t __p0) {
53395 poly64x1_t __ret;
53396 __ret = __builtin_shufflevector(__p0, __p0, 1);
55124__ai int8x16_t vqtbl1q_s8(int8x16_t __p0, uint8x16_t __p1) {
55125 int8x16_t __ret;
55126 __ret = (int8x16_t) __builtin_neon_vqtbl1q_v((int8x16_t)__p0, (int8x16_t)__p1, 32);
5339755127 return __ret;
5339855128}
5339955129#else
53400__ai poly64x1_t vget_high_p64(poly64x2_t __p0) {
53401 poly64x1_t __ret;
53402 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
53403 __ret = __builtin_shufflevector(__rev0, __rev0, 1);
55130__ai int8x16_t vqtbl1q_s8(int8x16_t __p0, uint8x16_t __p1) {
55131 int8x16_t __ret;
55132 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55133 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55134 __ret = (int8x16_t) __builtin_neon_vqtbl1q_v((int8x16_t)__rev0, (int8x16_t)__rev1, 32);
55135 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
5340455136 return __ret;
5340555137}
53406__ai poly64x1_t __noswap_vget_high_p64(poly64x2_t __p0) {
53407 poly64x1_t __ret;
53408 __ret = __builtin_shufflevector(__p0, __p0, 1);
55138#endif
55139
55140#ifdef __LITTLE_ENDIAN__
55141__ai uint8x8_t vqtbl1_u8(uint8x16_t __p0, uint8x8_t __p1) {
55142 uint8x8_t __ret;
55143 __ret = (uint8x8_t) __builtin_neon_vqtbl1_v((int8x16_t)__p0, (int8x8_t)__p1, 16);
55144 return __ret;
55145}
55146#else
55147__ai uint8x8_t vqtbl1_u8(uint8x16_t __p0, uint8x8_t __p1) {
55148 uint8x8_t __ret;
55149 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55150 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
55151 __ret = (uint8x8_t) __builtin_neon_vqtbl1_v((int8x16_t)__rev0, (int8x8_t)__rev1, 16);
55152 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
5340955153 return __ret;
5341055154}
5341155155#endif
5341255156
5341355157#ifdef __LITTLE_ENDIAN__
53414__ai float64x1_t vget_high_f64(float64x2_t __p0) {
53415 float64x1_t __ret;
53416 __ret = __builtin_shufflevector(__p0, __p0, 1);
55158__ai int8x8_t vqtbl1_s8(int8x16_t __p0, uint8x8_t __p1) {
55159 int8x8_t __ret;
55160 __ret = (int8x8_t) __builtin_neon_vqtbl1_v((int8x16_t)__p0, (int8x8_t)__p1, 0);
5341755161 return __ret;
5341855162}
5341955163#else
53420__ai float64x1_t vget_high_f64(float64x2_t __p0) {
53421 float64x1_t __ret;
53422 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
53423 __ret = __builtin_shufflevector(__rev0, __rev0, 1);
55164__ai int8x8_t vqtbl1_s8(int8x16_t __p0, uint8x8_t __p1) {
55165 int8x8_t __ret;
55166 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55167 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
55168 __ret = (int8x8_t) __builtin_neon_vqtbl1_v((int8x16_t)__rev0, (int8x8_t)__rev1, 0);
55169 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
5342455170 return __ret;
5342555171}
5342655172#endif
5342755173
53428#define vget_lane_p64(__p0, __p1) __extension__ ({ \
53429 poly64_t __ret; \
53430 poly64x1_t __s0 = __p0; \
53431 __ret = (poly64_t) __builtin_neon_vget_lane_i64((poly64x1_t)__s0, __p1); \
53432 __ret; \
53433})
5343455174#ifdef __LITTLE_ENDIAN__
53435#define vgetq_lane_p64(__p0, __p1) __extension__ ({ \
53436 poly64_t __ret; \
53437 poly64x2_t __s0 = __p0; \
53438 __ret = (poly64_t) __builtin_neon_vgetq_lane_i64((poly64x2_t)__s0, __p1); \
53439 __ret; \
53440})
55175__ai poly8x8_t vqtbl2_p8(poly8x16x2_t __p0, uint8x8_t __p1) {
55176 poly8x8_t __ret;
55177 __ret = (poly8x8_t) __builtin_neon_vqtbl2_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x8_t)__p1, 4);
55178 return __ret;
55179}
5344155180#else
53442#define vgetq_lane_p64(__p0, __p1) __extension__ ({ \
53443 poly64_t __ret; \
53444 poly64x2_t __s0 = __p0; \
53445 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
53446 __ret = (poly64_t) __builtin_neon_vgetq_lane_i64((poly64x2_t)__rev0, __p1); \
53447 __ret; \
53448})
53449#define __noswap_vgetq_lane_p64(__p0, __p1) __extension__ ({ \
53450 poly64_t __ret; \
53451 poly64x2_t __s0 = __p0; \
53452 __ret = (poly64_t) __builtin_neon_vgetq_lane_i64((poly64x2_t)__s0, __p1); \
53453 __ret; \
53454})
55181__ai poly8x8_t vqtbl2_p8(poly8x16x2_t __p0, uint8x8_t __p1) {
55182 poly8x8_t __ret;
55183 poly8x16x2_t __rev0;
55184 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55185 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55186 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
55187 __ret = (poly8x8_t) __builtin_neon_vqtbl2_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x8_t)__rev1, 4);
55188 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
55189 return __ret;
55190}
5345555191#endif
5345655192
5345755193#ifdef __LITTLE_ENDIAN__
53458#define vgetq_lane_f64(__p0, __p1) __extension__ ({ \
53459 float64_t __ret; \
53460 float64x2_t __s0 = __p0; \
53461 __ret = (float64_t) __builtin_neon_vgetq_lane_f64((float64x2_t)__s0, __p1); \
53462 __ret; \
53463})
55194__ai poly8x16_t vqtbl2q_p8(poly8x16x2_t __p0, uint8x16_t __p1) {
55195 poly8x16_t __ret;
55196 __ret = (poly8x16_t) __builtin_neon_vqtbl2q_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p1, 36);
55197 return __ret;
55198}
5346455199#else
53465#define vgetq_lane_f64(__p0, __p1) __extension__ ({ \
53466 float64_t __ret; \
53467 float64x2_t __s0 = __p0; \
53468 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
53469 __ret = (float64_t) __builtin_neon_vgetq_lane_f64((float64x2_t)__rev0, __p1); \
53470 __ret; \
53471})
53472#define __noswap_vgetq_lane_f64(__p0, __p1) __extension__ ({ \
53473 float64_t __ret; \
53474 float64x2_t __s0 = __p0; \
53475 __ret = (float64_t) __builtin_neon_vgetq_lane_f64((float64x2_t)__s0, __p1); \
53476 __ret; \
53477})
55200__ai poly8x16_t vqtbl2q_p8(poly8x16x2_t __p0, uint8x16_t __p1) {
55201 poly8x16_t __ret;
55202 poly8x16x2_t __rev0;
55203 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55204 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55205 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55206 __ret = (poly8x16_t) __builtin_neon_vqtbl2q_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev1, 36);
55207 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55208 return __ret;
55209}
5347855210#endif
5347955211
53480#define vget_lane_f64(__p0, __p1) __extension__ ({ \
53481 float64_t __ret; \
53482 float64x1_t __s0 = __p0; \
53483 __ret = (float64_t) __builtin_neon_vget_lane_f64((float64x1_t)__s0, __p1); \
53484 __ret; \
53485})
5348655212#ifdef __LITTLE_ENDIAN__
53487__ai poly64x1_t vget_low_p64(poly64x2_t __p0) {
53488 poly64x1_t __ret;
53489 __ret = __builtin_shufflevector(__p0, __p0, 0);
55213__ai uint8x16_t vqtbl2q_u8(uint8x16x2_t __p0, uint8x16_t __p1) {
55214 uint8x16_t __ret;
55215 __ret = (uint8x16_t) __builtin_neon_vqtbl2q_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p1, 48);
5349055216 return __ret;
5349155217}
5349255218#else
53493__ai poly64x1_t vget_low_p64(poly64x2_t __p0) {
53494 poly64x1_t __ret;
53495 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
53496 __ret = __builtin_shufflevector(__rev0, __rev0, 0);
55219__ai uint8x16_t vqtbl2q_u8(uint8x16x2_t __p0, uint8x16_t __p1) {
55220 uint8x16_t __ret;
55221 uint8x16x2_t __rev0;
55222 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55223 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55224 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55225 __ret = (uint8x16_t) __builtin_neon_vqtbl2q_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev1, 48);
55226 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
5349755227 return __ret;
5349855228}
5349955229#endif
5350055230
5350155231#ifdef __LITTLE_ENDIAN__
53502__ai float64x1_t vget_low_f64(float64x2_t __p0) {
53503 float64x1_t __ret;
53504 __ret = __builtin_shufflevector(__p0, __p0, 0);
55232__ai int8x16_t vqtbl2q_s8(int8x16x2_t __p0, uint8x16_t __p1) {
55233 int8x16_t __ret;
55234 __ret = (int8x16_t) __builtin_neon_vqtbl2q_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p1, 32);
5350555235 return __ret;
5350655236}
5350755237#else
53508__ai float64x1_t vget_low_f64(float64x2_t __p0) {
53509 float64x1_t __ret;
53510 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
53511 __ret = __builtin_shufflevector(__rev0, __rev0, 0);
55238__ai int8x16_t vqtbl2q_s8(int8x16x2_t __p0, uint8x16_t __p1) {
55239 int8x16_t __ret;
55240 int8x16x2_t __rev0;
55241 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55242 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55243 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55244 __ret = (int8x16_t) __builtin_neon_vqtbl2q_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev1, 32);
55245 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
5351255246 return __ret;
5351355247}
5351455248#endif
5351555249
53516#define vld1_p64(__p0) __extension__ ({ \
53517 poly64x1_t __ret; \
53518 __ret = (poly64x1_t) __builtin_neon_vld1_v(__p0, 6); \
53519 __ret; \
53520})
53521#ifdef __LITTLE_ENDIAN__
53522#define vld1q_p64(__p0) __extension__ ({ \
53523 poly64x2_t __ret; \
53524 __ret = (poly64x2_t) __builtin_neon_vld1q_v(__p0, 38); \
53525 __ret; \
53526})
53527#else
53528#define vld1q_p64(__p0) __extension__ ({ \
53529 poly64x2_t __ret; \
53530 __ret = (poly64x2_t) __builtin_neon_vld1q_v(__p0, 38); \
53531 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
53532 __ret; \
53533})
53534#endif
53535
5353655250#ifdef __LITTLE_ENDIAN__
53537#define vld1q_f64(__p0) __extension__ ({ \
53538 float64x2_t __ret; \
53539 __ret = (float64x2_t) __builtin_neon_vld1q_v(__p0, 42); \
53540 __ret; \
53541})
55251__ai uint8x8_t vqtbl2_u8(uint8x16x2_t __p0, uint8x8_t __p1) {
55252 uint8x8_t __ret;
55253 __ret = (uint8x8_t) __builtin_neon_vqtbl2_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x8_t)__p1, 16);
55254 return __ret;
55255}
5354255256#else
53543#define vld1q_f64(__p0) __extension__ ({ \
53544 float64x2_t __ret; \
53545 __ret = (float64x2_t) __builtin_neon_vld1q_v(__p0, 42); \
53546 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
53547 __ret; \
53548})
55257__ai uint8x8_t vqtbl2_u8(uint8x16x2_t __p0, uint8x8_t __p1) {
55258 uint8x8_t __ret;
55259 uint8x16x2_t __rev0;
55260 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55261 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55262 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
55263 __ret = (uint8x8_t) __builtin_neon_vqtbl2_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x8_t)__rev1, 16);
55264 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
55265 return __ret;
55266}
5354955267#endif
5355055268
53551#define vld1_f64(__p0) __extension__ ({ \
53552 float64x1_t __ret; \
53553 __ret = (float64x1_t) __builtin_neon_vld1_v(__p0, 10); \
53554 __ret; \
53555})
53556#define vld1_dup_p64(__p0) __extension__ ({ \
53557 poly64x1_t __ret; \
53558 __ret = (poly64x1_t) __builtin_neon_vld1_dup_v(__p0, 6); \
53559 __ret; \
53560})
5356155269#ifdef __LITTLE_ENDIAN__
53562#define vld1q_dup_p64(__p0) __extension__ ({ \
53563 poly64x2_t __ret; \
53564 __ret = (poly64x2_t) __builtin_neon_vld1q_dup_v(__p0, 38); \
53565 __ret; \
53566})
55270__ai int8x8_t vqtbl2_s8(int8x16x2_t __p0, uint8x8_t __p1) {
55271 int8x8_t __ret;
55272 __ret = (int8x8_t) __builtin_neon_vqtbl2_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x8_t)__p1, 0);
55273 return __ret;
55274}
5356755275#else
53568#define vld1q_dup_p64(__p0) __extension__ ({ \
53569 poly64x2_t __ret; \
53570 __ret = (poly64x2_t) __builtin_neon_vld1q_dup_v(__p0, 38); \
53571 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
53572 __ret; \
53573})
55276__ai int8x8_t vqtbl2_s8(int8x16x2_t __p0, uint8x8_t __p1) {
55277 int8x8_t __ret;
55278 int8x16x2_t __rev0;
55279 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55280 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55281 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
55282 __ret = (int8x8_t) __builtin_neon_vqtbl2_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x8_t)__rev1, 0);
55283 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
55284 return __ret;
55285}
5357455286#endif
5357555287
5357655288#ifdef __LITTLE_ENDIAN__
53577#define vld1q_dup_f64(__p0) __extension__ ({ \
53578 float64x2_t __ret; \
53579 __ret = (float64x2_t) __builtin_neon_vld1q_dup_v(__p0, 42); \
53580 __ret; \
53581})
55289__ai poly8x8_t vqtbl3_p8(poly8x16x3_t __p0, uint8x8_t __p1) {
55290 poly8x8_t __ret;
55291 __ret = (poly8x8_t) __builtin_neon_vqtbl3_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p0.val[2], (int8x8_t)__p1, 4);
55292 return __ret;
55293}
5358255294#else
53583#define vld1q_dup_f64(__p0) __extension__ ({ \
53584 float64x2_t __ret; \
53585 __ret = (float64x2_t) __builtin_neon_vld1q_dup_v(__p0, 42); \
53586 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
53587 __ret; \
53588})
55295__ai poly8x8_t vqtbl3_p8(poly8x16x3_t __p0, uint8x8_t __p1) {
55296 poly8x8_t __ret;
55297 poly8x16x3_t __rev0;
55298 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55299 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55300 __rev0.val[2] = __builtin_shufflevector(__p0.val[2], __p0.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55301 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
55302 __ret = (poly8x8_t) __builtin_neon_vqtbl3_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev0.val[2], (int8x8_t)__rev1, 4);
55303 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
55304 return __ret;
55305}
5358955306#endif
5359055307
53591#define vld1_dup_f64(__p0) __extension__ ({ \
53592 float64x1_t __ret; \
53593 __ret = (float64x1_t) __builtin_neon_vld1_dup_v(__p0, 10); \
53594 __ret; \
53595})
53596#define vld1_lane_p64(__p0, __p1, __p2) __extension__ ({ \
53597 poly64x1_t __ret; \
53598 poly64x1_t __s1 = __p1; \
53599 __ret = (poly64x1_t) __builtin_neon_vld1_lane_v(__p0, (int8x8_t)__s1, __p2, 6); \
53600 __ret; \
53601})
5360255308#ifdef __LITTLE_ENDIAN__
53603#define vld1q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
53604 poly64x2_t __ret; \
53605 poly64x2_t __s1 = __p1; \
53606 __ret = (poly64x2_t) __builtin_neon_vld1q_lane_v(__p0, (int8x16_t)__s1, __p2, 38); \
53607 __ret; \
53608})
55309__ai poly8x16_t vqtbl3q_p8(poly8x16x3_t __p0, uint8x16_t __p1) {
55310 poly8x16_t __ret;
55311 __ret = (poly8x16_t) __builtin_neon_vqtbl3q_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p0.val[2], (int8x16_t)__p1, 36);
55312 return __ret;
55313}
5360955314#else
53610#define vld1q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
53611 poly64x2_t __ret; \
53612 poly64x2_t __s1 = __p1; \
53613 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
53614 __ret = (poly64x2_t) __builtin_neon_vld1q_lane_v(__p0, (int8x16_t)__rev1, __p2, 38); \
53615 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
53616 __ret; \
53617})
55315__ai poly8x16_t vqtbl3q_p8(poly8x16x3_t __p0, uint8x16_t __p1) {
55316 poly8x16_t __ret;
55317 poly8x16x3_t __rev0;
55318 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55319 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55320 __rev0.val[2] = __builtin_shufflevector(__p0.val[2], __p0.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55321 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55322 __ret = (poly8x16_t) __builtin_neon_vqtbl3q_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev0.val[2], (int8x16_t)__rev1, 36);
55323 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55324 return __ret;
55325}
5361855326#endif
5361955327
5362055328#ifdef __LITTLE_ENDIAN__
53621#define vld1q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
53622 float64x2_t __ret; \
53623 float64x2_t __s1 = __p1; \
53624 __ret = (float64x2_t) __builtin_neon_vld1q_lane_v(__p0, (int8x16_t)__s1, __p2, 42); \
53625 __ret; \
53626})
55329__ai uint8x16_t vqtbl3q_u8(uint8x16x3_t __p0, uint8x16_t __p1) {
55330 uint8x16_t __ret;
55331 __ret = (uint8x16_t) __builtin_neon_vqtbl3q_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p0.val[2], (int8x16_t)__p1, 48);
55332 return __ret;
55333}
5362755334#else
53628#define vld1q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
53629 float64x2_t __ret; \
53630 float64x2_t __s1 = __p1; \
53631 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
53632 __ret = (float64x2_t) __builtin_neon_vld1q_lane_v(__p0, (int8x16_t)__rev1, __p2, 42); \
53633 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
53634 __ret; \
53635})
55335__ai uint8x16_t vqtbl3q_u8(uint8x16x3_t __p0, uint8x16_t __p1) {
55336 uint8x16_t __ret;
55337 uint8x16x3_t __rev0;
55338 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55339 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55340 __rev0.val[2] = __builtin_shufflevector(__p0.val[2], __p0.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55341 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55342 __ret = (uint8x16_t) __builtin_neon_vqtbl3q_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev0.val[2], (int8x16_t)__rev1, 48);
55343 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55344 return __ret;
55345}
5363655346#endif
5363755347
53638#define vld1_lane_f64(__p0, __p1, __p2) __extension__ ({ \
53639 float64x1_t __ret; \
53640 float64x1_t __s1 = __p1; \
53641 __ret = (float64x1_t) __builtin_neon_vld1_lane_v(__p0, (int8x8_t)__s1, __p2, 10); \
53642 __ret; \
53643})
53644#define vld1_p64_x2(__p0) __extension__ ({ \
53645 poly64x1x2_t __ret; \
53646 __builtin_neon_vld1_x2_v(&__ret, __p0, 6); \
53647 __ret; \
53648})
5364955348#ifdef __LITTLE_ENDIAN__
53650#define vld1q_p64_x2(__p0) __extension__ ({ \
53651 poly64x2x2_t __ret; \
53652 __builtin_neon_vld1q_x2_v(&__ret, __p0, 38); \
53653 __ret; \
53654})
55349__ai int8x16_t vqtbl3q_s8(int8x16x3_t __p0, uint8x16_t __p1) {
55350 int8x16_t __ret;
55351 __ret = (int8x16_t) __builtin_neon_vqtbl3q_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p0.val[2], (int8x16_t)__p1, 32);
55352 return __ret;
55353}
5365555354#else
53656#define vld1q_p64_x2(__p0) __extension__ ({ \
53657 poly64x2x2_t __ret; \
53658 __builtin_neon_vld1q_x2_v(&__ret, __p0, 38); \
53659 \
53660 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
53661 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
53662 __ret; \
53663})
55355__ai int8x16_t vqtbl3q_s8(int8x16x3_t __p0, uint8x16_t __p1) {
55356 int8x16_t __ret;
55357 int8x16x3_t __rev0;
55358 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55359 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55360 __rev0.val[2] = __builtin_shufflevector(__p0.val[2], __p0.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55361 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55362 __ret = (int8x16_t) __builtin_neon_vqtbl3q_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev0.val[2], (int8x16_t)__rev1, 32);
55363 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55364 return __ret;
55365}
5366455366#endif
5366555367
5366655368#ifdef __LITTLE_ENDIAN__
53667#define vld1q_f64_x2(__p0) __extension__ ({ \
53668 float64x2x2_t __ret; \
53669 __builtin_neon_vld1q_x2_v(&__ret, __p0, 42); \
53670 __ret; \
53671})
55369__ai uint8x8_t vqtbl3_u8(uint8x16x3_t __p0, uint8x8_t __p1) {
55370 uint8x8_t __ret;
55371 __ret = (uint8x8_t) __builtin_neon_vqtbl3_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p0.val[2], (int8x8_t)__p1, 16);
55372 return __ret;
55373}
5367255374#else
53673#define vld1q_f64_x2(__p0) __extension__ ({ \
53674 float64x2x2_t __ret; \
53675 __builtin_neon_vld1q_x2_v(&__ret, __p0, 42); \
53676 \
53677 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
53678 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
53679 __ret; \
53680})
55375__ai uint8x8_t vqtbl3_u8(uint8x16x3_t __p0, uint8x8_t __p1) {
55376 uint8x8_t __ret;
55377 uint8x16x3_t __rev0;
55378 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55379 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55380 __rev0.val[2] = __builtin_shufflevector(__p0.val[2], __p0.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55381 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
55382 __ret = (uint8x8_t) __builtin_neon_vqtbl3_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev0.val[2], (int8x8_t)__rev1, 16);
55383 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
55384 return __ret;
55385}
5368155386#endif
5368255387
53683#define vld1_f64_x2(__p0) __extension__ ({ \
53684 float64x1x2_t __ret; \
53685 __builtin_neon_vld1_x2_v(&__ret, __p0, 10); \
53686 __ret; \
53687})
53688#define vld1_p64_x3(__p0) __extension__ ({ \
53689 poly64x1x3_t __ret; \
53690 __builtin_neon_vld1_x3_v(&__ret, __p0, 6); \
53691 __ret; \
53692})
5369355388#ifdef __LITTLE_ENDIAN__
53694#define vld1q_p64_x3(__p0) __extension__ ({ \
53695 poly64x2x3_t __ret; \
53696 __builtin_neon_vld1q_x3_v(&__ret, __p0, 38); \
53697 __ret; \
53698})
55389__ai int8x8_t vqtbl3_s8(int8x16x3_t __p0, uint8x8_t __p1) {
55390 int8x8_t __ret;
55391 __ret = (int8x8_t) __builtin_neon_vqtbl3_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p0.val[2], (int8x8_t)__p1, 0);
55392 return __ret;
55393}
5369955394#else
53700#define vld1q_p64_x3(__p0) __extension__ ({ \
53701 poly64x2x3_t __ret; \
53702 __builtin_neon_vld1q_x3_v(&__ret, __p0, 38); \
53703 \
53704 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
53705 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
53706 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
53707 __ret; \
53708})
55395__ai int8x8_t vqtbl3_s8(int8x16x3_t __p0, uint8x8_t __p1) {
55396 int8x8_t __ret;
55397 int8x16x3_t __rev0;
55398 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55399 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55400 __rev0.val[2] = __builtin_shufflevector(__p0.val[2], __p0.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55401 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
55402 __ret = (int8x8_t) __builtin_neon_vqtbl3_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev0.val[2], (int8x8_t)__rev1, 0);
55403 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
55404 return __ret;
55405}
5370955406#endif
5371055407
5371155408#ifdef __LITTLE_ENDIAN__
53712#define vld1q_f64_x3(__p0) __extension__ ({ \
53713 float64x2x3_t __ret; \
53714 __builtin_neon_vld1q_x3_v(&__ret, __p0, 42); \
53715 __ret; \
53716})
55409__ai poly8x8_t vqtbl4_p8(poly8x16x4_t __p0, uint8x8_t __p1) {
55410 poly8x8_t __ret;
55411 __ret = (poly8x8_t) __builtin_neon_vqtbl4_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p0.val[2], (int8x16_t)__p0.val[3], (int8x8_t)__p1, 4);
55412 return __ret;
55413}
5371755414#else
53718#define vld1q_f64_x3(__p0) __extension__ ({ \
53719 float64x2x3_t __ret; \
53720 __builtin_neon_vld1q_x3_v(&__ret, __p0, 42); \
53721 \
53722 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
53723 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
53724 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
53725 __ret; \
53726})
55415__ai poly8x8_t vqtbl4_p8(poly8x16x4_t __p0, uint8x8_t __p1) {
55416 poly8x8_t __ret;
55417 poly8x16x4_t __rev0;
55418 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55419 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55420 __rev0.val[2] = __builtin_shufflevector(__p0.val[2], __p0.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55421 __rev0.val[3] = __builtin_shufflevector(__p0.val[3], __p0.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55422 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
55423 __ret = (poly8x8_t) __builtin_neon_vqtbl4_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev0.val[2], (int8x16_t)__rev0.val[3], (int8x8_t)__rev1, 4);
55424 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
55425 return __ret;
55426}
5372755427#endif
5372855428
53729#define vld1_f64_x3(__p0) __extension__ ({ \
53730 float64x1x3_t __ret; \
53731 __builtin_neon_vld1_x3_v(&__ret, __p0, 10); \
53732 __ret; \
53733})
53734#define vld1_p64_x4(__p0) __extension__ ({ \
53735 poly64x1x4_t __ret; \
53736 __builtin_neon_vld1_x4_v(&__ret, __p0, 6); \
53737 __ret; \
53738})
5373955429#ifdef __LITTLE_ENDIAN__
53740#define vld1q_p64_x4(__p0) __extension__ ({ \
53741 poly64x2x4_t __ret; \
53742 __builtin_neon_vld1q_x4_v(&__ret, __p0, 38); \
53743 __ret; \
53744})
55430__ai poly8x16_t vqtbl4q_p8(poly8x16x4_t __p0, uint8x16_t __p1) {
55431 poly8x16_t __ret;
55432 __ret = (poly8x16_t) __builtin_neon_vqtbl4q_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p0.val[2], (int8x16_t)__p0.val[3], (int8x16_t)__p1, 36);
55433 return __ret;
55434}
5374555435#else
53746#define vld1q_p64_x4(__p0) __extension__ ({ \
53747 poly64x2x4_t __ret; \
53748 __builtin_neon_vld1q_x4_v(&__ret, __p0, 38); \
53749 \
53750 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
53751 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
53752 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
53753 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 1, 0); \
53754 __ret; \
53755})
55436__ai poly8x16_t vqtbl4q_p8(poly8x16x4_t __p0, uint8x16_t __p1) {
55437 poly8x16_t __ret;
55438 poly8x16x4_t __rev0;
55439 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55440 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55441 __rev0.val[2] = __builtin_shufflevector(__p0.val[2], __p0.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55442 __rev0.val[3] = __builtin_shufflevector(__p0.val[3], __p0.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55443 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55444 __ret = (poly8x16_t) __builtin_neon_vqtbl4q_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev0.val[2], (int8x16_t)__rev0.val[3], (int8x16_t)__rev1, 36);
55445 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55446 return __ret;
55447}
5375655448#endif
5375755449
5375855450#ifdef __LITTLE_ENDIAN__
53759#define vld1q_f64_x4(__p0) __extension__ ({ \
53760 float64x2x4_t __ret; \
53761 __builtin_neon_vld1q_x4_v(&__ret, __p0, 42); \
53762 __ret; \
53763})
55451__ai uint8x16_t vqtbl4q_u8(uint8x16x4_t __p0, uint8x16_t __p1) {
55452 uint8x16_t __ret;
55453 __ret = (uint8x16_t) __builtin_neon_vqtbl4q_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p0.val[2], (int8x16_t)__p0.val[3], (int8x16_t)__p1, 48);
55454 return __ret;
55455}
5376455456#else
53765#define vld1q_f64_x4(__p0) __extension__ ({ \
53766 float64x2x4_t __ret; \
53767 __builtin_neon_vld1q_x4_v(&__ret, __p0, 42); \
53768 \
53769 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
53770 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
53771 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
53772 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 1, 0); \
53773 __ret; \
53774})
55457__ai uint8x16_t vqtbl4q_u8(uint8x16x4_t __p0, uint8x16_t __p1) {
55458 uint8x16_t __ret;
55459 uint8x16x4_t __rev0;
55460 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55461 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55462 __rev0.val[2] = __builtin_shufflevector(__p0.val[2], __p0.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55463 __rev0.val[3] = __builtin_shufflevector(__p0.val[3], __p0.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55464 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55465 __ret = (uint8x16_t) __builtin_neon_vqtbl4q_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev0.val[2], (int8x16_t)__rev0.val[3], (int8x16_t)__rev1, 48);
55466 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55467 return __ret;
55468}
5377555469#endif
5377655470
53777#define vld1_f64_x4(__p0) __extension__ ({ \
53778 float64x1x4_t __ret; \
53779 __builtin_neon_vld1_x4_v(&__ret, __p0, 10); \
53780 __ret; \
53781})
53782#define vld2_p64(__p0) __extension__ ({ \
53783 poly64x1x2_t __ret; \
53784 __builtin_neon_vld2_v(&__ret, __p0, 6); \
53785 __ret; \
53786})
5378755471#ifdef __LITTLE_ENDIAN__
53788#define vld2q_p64(__p0) __extension__ ({ \
53789 poly64x2x2_t __ret; \
53790 __builtin_neon_vld2q_v(&__ret, __p0, 38); \
53791 __ret; \
53792})
55472__ai int8x16_t vqtbl4q_s8(int8x16x4_t __p0, uint8x16_t __p1) {
55473 int8x16_t __ret;
55474 __ret = (int8x16_t) __builtin_neon_vqtbl4q_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p0.val[2], (int8x16_t)__p0.val[3], (int8x16_t)__p1, 32);
55475 return __ret;
55476}
5379355477#else
53794#define vld2q_p64(__p0) __extension__ ({ \
53795 poly64x2x2_t __ret; \
53796 __builtin_neon_vld2q_v(&__ret, __p0, 38); \
53797 \
53798 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
53799 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
53800 __ret; \
53801})
55478__ai int8x16_t vqtbl4q_s8(int8x16x4_t __p0, uint8x16_t __p1) {
55479 int8x16_t __ret;
55480 int8x16x4_t __rev0;
55481 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55482 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55483 __rev0.val[2] = __builtin_shufflevector(__p0.val[2], __p0.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55484 __rev0.val[3] = __builtin_shufflevector(__p0.val[3], __p0.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55485 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55486 __ret = (int8x16_t) __builtin_neon_vqtbl4q_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev0.val[2], (int8x16_t)__rev0.val[3], (int8x16_t)__rev1, 32);
55487 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55488 return __ret;
55489}
5380255490#endif
5380355491
5380455492#ifdef __LITTLE_ENDIAN__
53805#define vld2q_u64(__p0) __extension__ ({ \
53806 uint64x2x2_t __ret; \
53807 __builtin_neon_vld2q_v(&__ret, __p0, 51); \
53808 __ret; \
53809})
55493__ai uint8x8_t vqtbl4_u8(uint8x16x4_t __p0, uint8x8_t __p1) {
55494 uint8x8_t __ret;
55495 __ret = (uint8x8_t) __builtin_neon_vqtbl4_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p0.val[2], (int8x16_t)__p0.val[3], (int8x8_t)__p1, 16);
55496 return __ret;
55497}
5381055498#else
53811#define vld2q_u64(__p0) __extension__ ({ \
53812 uint64x2x2_t __ret; \
53813 __builtin_neon_vld2q_v(&__ret, __p0, 51); \
53814 \
53815 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
53816 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
53817 __ret; \
53818})
55499__ai uint8x8_t vqtbl4_u8(uint8x16x4_t __p0, uint8x8_t __p1) {
55500 uint8x8_t __ret;
55501 uint8x16x4_t __rev0;
55502 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55503 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55504 __rev0.val[2] = __builtin_shufflevector(__p0.val[2], __p0.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55505 __rev0.val[3] = __builtin_shufflevector(__p0.val[3], __p0.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55506 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
55507 __ret = (uint8x8_t) __builtin_neon_vqtbl4_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev0.val[2], (int8x16_t)__rev0.val[3], (int8x8_t)__rev1, 16);
55508 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
55509 return __ret;
55510}
5381955511#endif
5382055512
5382155513#ifdef __LITTLE_ENDIAN__
53822#define vld2q_f64(__p0) __extension__ ({ \
53823 float64x2x2_t __ret; \
53824 __builtin_neon_vld2q_v(&__ret, __p0, 42); \
53825 __ret; \
53826})
55514__ai int8x8_t vqtbl4_s8(int8x16x4_t __p0, uint8x8_t __p1) {
55515 int8x8_t __ret;
55516 __ret = (int8x8_t) __builtin_neon_vqtbl4_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p0.val[2], (int8x16_t)__p0.val[3], (int8x8_t)__p1, 0);
55517 return __ret;
55518}
5382755519#else
53828#define vld2q_f64(__p0) __extension__ ({ \
53829 float64x2x2_t __ret; \
53830 __builtin_neon_vld2q_v(&__ret, __p0, 42); \
53831 \
53832 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
53833 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
53834 __ret; \
53835})
55520__ai int8x8_t vqtbl4_s8(int8x16x4_t __p0, uint8x8_t __p1) {
55521 int8x8_t __ret;
55522 int8x16x4_t __rev0;
55523 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55524 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55525 __rev0.val[2] = __builtin_shufflevector(__p0.val[2], __p0.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55526 __rev0.val[3] = __builtin_shufflevector(__p0.val[3], __p0.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55527 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
55528 __ret = (int8x8_t) __builtin_neon_vqtbl4_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev0.val[2], (int8x16_t)__rev0.val[3], (int8x8_t)__rev1, 0);
55529 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
55530 return __ret;
55531}
5383655532#endif
5383755533
5383855534#ifdef __LITTLE_ENDIAN__
53839#define vld2q_s64(__p0) __extension__ ({ \
53840 int64x2x2_t __ret; \
53841 __builtin_neon_vld2q_v(&__ret, __p0, 35); \
53842 __ret; \
53843})
55535__ai poly8x8_t vqtbx1_p8(poly8x8_t __p0, poly8x16_t __p1, uint8x8_t __p2) {
55536 poly8x8_t __ret;
55537 __ret = (poly8x8_t) __builtin_neon_vqtbx1_v((int8x8_t)__p0, (int8x16_t)__p1, (int8x8_t)__p2, 4);
55538 return __ret;
55539}
5384455540#else
53845#define vld2q_s64(__p0) __extension__ ({ \
53846 int64x2x2_t __ret; \
53847 __builtin_neon_vld2q_v(&__ret, __p0, 35); \
53848 \
53849 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
53850 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
53851 __ret; \
53852})
55541__ai poly8x8_t vqtbx1_p8(poly8x8_t __p0, poly8x16_t __p1, uint8x8_t __p2) {
55542 poly8x8_t __ret;
55543 poly8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
55544 poly8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55545 uint8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
55546 __ret = (poly8x8_t) __builtin_neon_vqtbx1_v((int8x8_t)__rev0, (int8x16_t)__rev1, (int8x8_t)__rev2, 4);
55547 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
55548 return __ret;
55549}
5385355550#endif
5385455551
53855#define vld2_f64(__p0) __extension__ ({ \
53856 float64x1x2_t __ret; \
53857 __builtin_neon_vld2_v(&__ret, __p0, 10); \
53858 __ret; \
53859})
53860#define vld2_dup_p64(__p0) __extension__ ({ \
53861 poly64x1x2_t __ret; \
53862 __builtin_neon_vld2_dup_v(&__ret, __p0, 6); \
53863 __ret; \
53864})
5386555552#ifdef __LITTLE_ENDIAN__
53866#define vld2q_dup_p64(__p0) __extension__ ({ \
53867 poly64x2x2_t __ret; \
53868 __builtin_neon_vld2q_dup_v(&__ret, __p0, 38); \
53869 __ret; \
53870})
55553__ai poly8x16_t vqtbx1q_p8(poly8x16_t __p0, poly8x16_t __p1, uint8x16_t __p2) {
55554 poly8x16_t __ret;
55555 __ret = (poly8x16_t) __builtin_neon_vqtbx1q_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 36);
55556 return __ret;
55557}
5387155558#else
53872#define vld2q_dup_p64(__p0) __extension__ ({ \
53873 poly64x2x2_t __ret; \
53874 __builtin_neon_vld2q_dup_v(&__ret, __p0, 38); \
53875 \
53876 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
53877 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
53878 __ret; \
53879})
55559__ai poly8x16_t vqtbx1q_p8(poly8x16_t __p0, poly8x16_t __p1, uint8x16_t __p2) {
55560 poly8x16_t __ret;
55561 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55562 poly8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55563 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55564 __ret = (poly8x16_t) __builtin_neon_vqtbx1q_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 36);
55565 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55566 return __ret;
55567}
5388055568#endif
5388155569
5388255570#ifdef __LITTLE_ENDIAN__
53883#define vld2q_dup_f64(__p0) __extension__ ({ \
53884 float64x2x2_t __ret; \
53885 __builtin_neon_vld2q_dup_v(&__ret, __p0, 42); \
53886 __ret; \
53887})
55571__ai uint8x16_t vqtbx1q_u8(uint8x16_t __p0, uint8x16_t __p1, uint8x16_t __p2) {
55572 uint8x16_t __ret;
55573 __ret = (uint8x16_t) __builtin_neon_vqtbx1q_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 48);
55574 return __ret;
55575}
5388855576#else
53889#define vld2q_dup_f64(__p0) __extension__ ({ \
53890 float64x2x2_t __ret; \
53891 __builtin_neon_vld2q_dup_v(&__ret, __p0, 42); \
53892 \
53893 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
53894 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
53895 __ret; \
53896})
55577__ai uint8x16_t vqtbx1q_u8(uint8x16_t __p0, uint8x16_t __p1, uint8x16_t __p2) {
55578 uint8x16_t __ret;
55579 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55580 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55581 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55582 __ret = (uint8x16_t) __builtin_neon_vqtbx1q_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 48);
55583 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55584 return __ret;
55585}
5389755586#endif
5389855587
53899#define vld2_dup_f64(__p0) __extension__ ({ \
53900 float64x1x2_t __ret; \
53901 __builtin_neon_vld2_dup_v(&__ret, __p0, 10); \
53902 __ret; \
53903})
53904#define vld2_lane_p64(__p0, __p1, __p2) __extension__ ({ \
53905 poly64x1x2_t __ret; \
53906 poly64x1x2_t __s1 = __p1; \
53907 __builtin_neon_vld2_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], __p2, 6); \
53908 __ret; \
53909})
5391055588#ifdef __LITTLE_ENDIAN__
53911#define vld2q_lane_p8(__p0, __p1, __p2) __extension__ ({ \
53912 poly8x16x2_t __ret; \
53913 poly8x16x2_t __s1 = __p1; \
53914 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 36); \
53915 __ret; \
53916})
55589__ai int8x16_t vqtbx1q_s8(int8x16_t __p0, int8x16_t __p1, uint8x16_t __p2) {
55590 int8x16_t __ret;
55591 __ret = (int8x16_t) __builtin_neon_vqtbx1q_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 32);
55592 return __ret;
55593}
5391755594#else
53918#define vld2q_lane_p8(__p0, __p1, __p2) __extension__ ({ \
53919 poly8x16x2_t __ret; \
53920 poly8x16x2_t __s1 = __p1; \
53921 poly8x16x2_t __rev1; \
53922 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
53923 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
53924 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 36); \
53925 \
53926 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
53927 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
53928 __ret; \
53929})
55595__ai int8x16_t vqtbx1q_s8(int8x16_t __p0, int8x16_t __p1, uint8x16_t __p2) {
55596 int8x16_t __ret;
55597 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55598 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55599 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55600 __ret = (int8x16_t) __builtin_neon_vqtbx1q_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 32);
55601 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55602 return __ret;
55603}
5393055604#endif
5393155605
5393255606#ifdef __LITTLE_ENDIAN__
53933#define vld2q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
53934 poly64x2x2_t __ret; \
53935 poly64x2x2_t __s1 = __p1; \
53936 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 38); \
53937 __ret; \
53938})
55607__ai uint8x8_t vqtbx1_u8(uint8x8_t __p0, uint8x16_t __p1, uint8x8_t __p2) {
55608 uint8x8_t __ret;
55609 __ret = (uint8x8_t) __builtin_neon_vqtbx1_v((int8x8_t)__p0, (int8x16_t)__p1, (int8x8_t)__p2, 16);
55610 return __ret;
55611}
5393955612#else
53940#define vld2q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
53941 poly64x2x2_t __ret; \
53942 poly64x2x2_t __s1 = __p1; \
53943 poly64x2x2_t __rev1; \
53944 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
53945 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
53946 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 38); \
53947 \
53948 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
53949 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
53950 __ret; \
53951})
55613__ai uint8x8_t vqtbx1_u8(uint8x8_t __p0, uint8x16_t __p1, uint8x8_t __p2) {
55614 uint8x8_t __ret;
55615 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
55616 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55617 uint8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
55618 __ret = (uint8x8_t) __builtin_neon_vqtbx1_v((int8x8_t)__rev0, (int8x16_t)__rev1, (int8x8_t)__rev2, 16);
55619 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
55620 return __ret;
55621}
5395255622#endif
5395355623
5395455624#ifdef __LITTLE_ENDIAN__
53955#define vld2q_lane_u8(__p0, __p1, __p2) __extension__ ({ \
53956 uint8x16x2_t __ret; \
53957 uint8x16x2_t __s1 = __p1; \
53958 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 48); \
53959 __ret; \
53960})
55625__ai int8x8_t vqtbx1_s8(int8x8_t __p0, int8x16_t __p1, uint8x8_t __p2) {
55626 int8x8_t __ret;
55627 __ret = (int8x8_t) __builtin_neon_vqtbx1_v((int8x8_t)__p0, (int8x16_t)__p1, (int8x8_t)__p2, 0);
55628 return __ret;
55629}
5396155630#else
53962#define vld2q_lane_u8(__p0, __p1, __p2) __extension__ ({ \
53963 uint8x16x2_t __ret; \
53964 uint8x16x2_t __s1 = __p1; \
53965 uint8x16x2_t __rev1; \
53966 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
53967 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
53968 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 48); \
53969 \
53970 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
53971 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
53972 __ret; \
53973})
55631__ai int8x8_t vqtbx1_s8(int8x8_t __p0, int8x16_t __p1, uint8x8_t __p2) {
55632 int8x8_t __ret;
55633 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
55634 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55635 uint8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
55636 __ret = (int8x8_t) __builtin_neon_vqtbx1_v((int8x8_t)__rev0, (int8x16_t)__rev1, (int8x8_t)__rev2, 0);
55637 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
55638 return __ret;
55639}
5397455640#endif
5397555641
5397655642#ifdef __LITTLE_ENDIAN__
53977#define vld2q_lane_u64(__p0, __p1, __p2) __extension__ ({ \
53978 uint64x2x2_t __ret; \
53979 uint64x2x2_t __s1 = __p1; \
53980 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 51); \
53981 __ret; \
53982})
55643__ai poly8x8_t vqtbx2_p8(poly8x8_t __p0, poly8x16x2_t __p1, uint8x8_t __p2) {
55644 poly8x8_t __ret;
55645 __ret = (poly8x8_t) __builtin_neon_vqtbx2_v((int8x8_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x8_t)__p2, 4);
55646 return __ret;
55647}
5398355648#else
53984#define vld2q_lane_u64(__p0, __p1, __p2) __extension__ ({ \
53985 uint64x2x2_t __ret; \
53986 uint64x2x2_t __s1 = __p1; \
53987 uint64x2x2_t __rev1; \
53988 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
53989 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
53990 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 51); \
53991 \
53992 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
53993 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
53994 __ret; \
53995})
55649__ai poly8x8_t vqtbx2_p8(poly8x8_t __p0, poly8x16x2_t __p1, uint8x8_t __p2) {
55650 poly8x8_t __ret;
55651 poly8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
55652 poly8x16x2_t __rev1;
55653 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55654 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55655 uint8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
55656 __ret = (poly8x8_t) __builtin_neon_vqtbx2_v((int8x8_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x8_t)__rev2, 4);
55657 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
55658 return __ret;
55659}
5399655660#endif
5399755661
5399855662#ifdef __LITTLE_ENDIAN__
53999#define vld2q_lane_s8(__p0, __p1, __p2) __extension__ ({ \
54000 int8x16x2_t __ret; \
54001 int8x16x2_t __s1 = __p1; \
54002 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 32); \
54003 __ret; \
54004})
55663__ai poly8x16_t vqtbx2q_p8(poly8x16_t __p0, poly8x16x2_t __p1, uint8x16_t __p2) {
55664 poly8x16_t __ret;
55665 __ret = (poly8x16_t) __builtin_neon_vqtbx2q_v((int8x16_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p2, 36);
55666 return __ret;
55667}
5400555668#else
54006#define vld2q_lane_s8(__p0, __p1, __p2) __extension__ ({ \
54007 int8x16x2_t __ret; \
54008 int8x16x2_t __s1 = __p1; \
54009 int8x16x2_t __rev1; \
54010 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54011 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54012 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 32); \
54013 \
54014 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54015 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54016 __ret; \
54017})
55669__ai poly8x16_t vqtbx2q_p8(poly8x16_t __p0, poly8x16x2_t __p1, uint8x16_t __p2) {
55670 poly8x16_t __ret;
55671 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55672 poly8x16x2_t __rev1;
55673 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55674 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55675 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55676 __ret = (poly8x16_t) __builtin_neon_vqtbx2q_v((int8x16_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev2, 36);
55677 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55678 return __ret;
55679}
5401855680#endif
5401955681
5402055682#ifdef __LITTLE_ENDIAN__
54021#define vld2q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
54022 float64x2x2_t __ret; \
54023 float64x2x2_t __s1 = __p1; \
54024 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 42); \
54025 __ret; \
54026})
55683__ai uint8x16_t vqtbx2q_u8(uint8x16_t __p0, uint8x16x2_t __p1, uint8x16_t __p2) {
55684 uint8x16_t __ret;
55685 __ret = (uint8x16_t) __builtin_neon_vqtbx2q_v((int8x16_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p2, 48);
55686 return __ret;
55687}
5402755688#else
54028#define vld2q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
54029 float64x2x2_t __ret; \
54030 float64x2x2_t __s1 = __p1; \
54031 float64x2x2_t __rev1; \
54032 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
54033 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
54034 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 42); \
54035 \
54036 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
54037 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
54038 __ret; \
54039})
55689__ai uint8x16_t vqtbx2q_u8(uint8x16_t __p0, uint8x16x2_t __p1, uint8x16_t __p2) {
55690 uint8x16_t __ret;
55691 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55692 uint8x16x2_t __rev1;
55693 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55694 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55695 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55696 __ret = (uint8x16_t) __builtin_neon_vqtbx2q_v((int8x16_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev2, 48);
55697 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55698 return __ret;
55699}
5404055700#endif
5404155701
5404255702#ifdef __LITTLE_ENDIAN__
54043#define vld2q_lane_s64(__p0, __p1, __p2) __extension__ ({ \
54044 int64x2x2_t __ret; \
54045 int64x2x2_t __s1 = __p1; \
54046 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 35); \
54047 __ret; \
54048})
55703__ai int8x16_t vqtbx2q_s8(int8x16_t __p0, int8x16x2_t __p1, uint8x16_t __p2) {
55704 int8x16_t __ret;
55705 __ret = (int8x16_t) __builtin_neon_vqtbx2q_v((int8x16_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p2, 32);
55706 return __ret;
55707}
5404955708#else
54050#define vld2q_lane_s64(__p0, __p1, __p2) __extension__ ({ \
54051 int64x2x2_t __ret; \
54052 int64x2x2_t __s1 = __p1; \
54053 int64x2x2_t __rev1; \
54054 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
54055 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
54056 __builtin_neon_vld2q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 35); \
54057 \
54058 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
54059 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
54060 __ret; \
54061})
55709__ai int8x16_t vqtbx2q_s8(int8x16_t __p0, int8x16x2_t __p1, uint8x16_t __p2) {
55710 int8x16_t __ret;
55711 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55712 int8x16x2_t __rev1;
55713 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55714 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55715 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55716 __ret = (int8x16_t) __builtin_neon_vqtbx2q_v((int8x16_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev2, 32);
55717 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55718 return __ret;
55719}
5406255720#endif
5406355721
54064#define vld2_lane_u64(__p0, __p1, __p2) __extension__ ({ \
54065 uint64x1x2_t __ret; \
54066 uint64x1x2_t __s1 = __p1; \
54067 __builtin_neon_vld2_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], __p2, 19); \
54068 __ret; \
54069})
54070#define vld2_lane_f64(__p0, __p1, __p2) __extension__ ({ \
54071 float64x1x2_t __ret; \
54072 float64x1x2_t __s1 = __p1; \
54073 __builtin_neon_vld2_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], __p2, 10); \
54074 __ret; \
54075})
54076#define vld2_lane_s64(__p0, __p1, __p2) __extension__ ({ \
54077 int64x1x2_t __ret; \
54078 int64x1x2_t __s1 = __p1; \
54079 __builtin_neon_vld2_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], __p2, 3); \
54080 __ret; \
54081})
54082#define vld3_p64(__p0) __extension__ ({ \
54083 poly64x1x3_t __ret; \
54084 __builtin_neon_vld3_v(&__ret, __p0, 6); \
54085 __ret; \
54086})
5408755722#ifdef __LITTLE_ENDIAN__
54088#define vld3q_p64(__p0) __extension__ ({ \
54089 poly64x2x3_t __ret; \
54090 __builtin_neon_vld3q_v(&__ret, __p0, 38); \
54091 __ret; \
54092})
55723__ai uint8x8_t vqtbx2_u8(uint8x8_t __p0, uint8x16x2_t __p1, uint8x8_t __p2) {
55724 uint8x8_t __ret;
55725 __ret = (uint8x8_t) __builtin_neon_vqtbx2_v((int8x8_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x8_t)__p2, 16);
55726 return __ret;
55727}
5409355728#else
54094#define vld3q_p64(__p0) __extension__ ({ \
54095 poly64x2x3_t __ret; \
54096 __builtin_neon_vld3q_v(&__ret, __p0, 38); \
54097 \
54098 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
54099 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
54100 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
54101 __ret; \
54102})
55729__ai uint8x8_t vqtbx2_u8(uint8x8_t __p0, uint8x16x2_t __p1, uint8x8_t __p2) {
55730 uint8x8_t __ret;
55731 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
55732 uint8x16x2_t __rev1;
55733 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55734 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55735 uint8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
55736 __ret = (uint8x8_t) __builtin_neon_vqtbx2_v((int8x8_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x8_t)__rev2, 16);
55737 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
55738 return __ret;
55739}
5410355740#endif
5410455741
5410555742#ifdef __LITTLE_ENDIAN__
54106#define vld3q_u64(__p0) __extension__ ({ \
54107 uint64x2x3_t __ret; \
54108 __builtin_neon_vld3q_v(&__ret, __p0, 51); \
54109 __ret; \
54110})
55743__ai int8x8_t vqtbx2_s8(int8x8_t __p0, int8x16x2_t __p1, uint8x8_t __p2) {
55744 int8x8_t __ret;
55745 __ret = (int8x8_t) __builtin_neon_vqtbx2_v((int8x8_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x8_t)__p2, 0);
55746 return __ret;
55747}
5411155748#else
54112#define vld3q_u64(__p0) __extension__ ({ \
54113 uint64x2x3_t __ret; \
54114 __builtin_neon_vld3q_v(&__ret, __p0, 51); \
54115 \
54116 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
54117 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
54118 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
54119 __ret; \
54120})
55749__ai int8x8_t vqtbx2_s8(int8x8_t __p0, int8x16x2_t __p1, uint8x8_t __p2) {
55750 int8x8_t __ret;
55751 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
55752 int8x16x2_t __rev1;
55753 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55754 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55755 uint8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
55756 __ret = (int8x8_t) __builtin_neon_vqtbx2_v((int8x8_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x8_t)__rev2, 0);
55757 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
55758 return __ret;
55759}
5412155760#endif
5412255761
5412355762#ifdef __LITTLE_ENDIAN__
54124#define vld3q_f64(__p0) __extension__ ({ \
54125 float64x2x3_t __ret; \
54126 __builtin_neon_vld3q_v(&__ret, __p0, 42); \
54127 __ret; \
54128})
55763__ai poly8x8_t vqtbx3_p8(poly8x8_t __p0, poly8x16x3_t __p1, uint8x8_t __p2) {
55764 poly8x8_t __ret;
55765 __ret = (poly8x8_t) __builtin_neon_vqtbx3_v((int8x8_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p1.val[2], (int8x8_t)__p2, 4);
55766 return __ret;
55767}
5412955768#else
54130#define vld3q_f64(__p0) __extension__ ({ \
54131 float64x2x3_t __ret; \
54132 __builtin_neon_vld3q_v(&__ret, __p0, 42); \
54133 \
54134 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
54135 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
54136 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
54137 __ret; \
54138})
55769__ai poly8x8_t vqtbx3_p8(poly8x8_t __p0, poly8x16x3_t __p1, uint8x8_t __p2) {
55770 poly8x8_t __ret;
55771 poly8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
55772 poly8x16x3_t __rev1;
55773 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55774 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55775 __rev1.val[2] = __builtin_shufflevector(__p1.val[2], __p1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55776 uint8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
55777 __ret = (poly8x8_t) __builtin_neon_vqtbx3_v((int8x8_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x8_t)__rev2, 4);
55778 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
55779 return __ret;
55780}
5413955781#endif
5414055782
5414155783#ifdef __LITTLE_ENDIAN__
54142#define vld3q_s64(__p0) __extension__ ({ \
54143 int64x2x3_t __ret; \
54144 __builtin_neon_vld3q_v(&__ret, __p0, 35); \
54145 __ret; \
54146})
55784__ai poly8x16_t vqtbx3q_p8(poly8x16_t __p0, poly8x16x3_t __p1, uint8x16_t __p2) {
55785 poly8x16_t __ret;
55786 __ret = (poly8x16_t) __builtin_neon_vqtbx3q_v((int8x16_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p1.val[2], (int8x16_t)__p2, 36);
55787 return __ret;
55788}
5414755789#else
54148#define vld3q_s64(__p0) __extension__ ({ \
54149 int64x2x3_t __ret; \
54150 __builtin_neon_vld3q_v(&__ret, __p0, 35); \
54151 \
54152 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
54153 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
54154 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
54155 __ret; \
54156})
55790__ai poly8x16_t vqtbx3q_p8(poly8x16_t __p0, poly8x16x3_t __p1, uint8x16_t __p2) {
55791 poly8x16_t __ret;
55792 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55793 poly8x16x3_t __rev1;
55794 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55795 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55796 __rev1.val[2] = __builtin_shufflevector(__p1.val[2], __p1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55797 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55798 __ret = (poly8x16_t) __builtin_neon_vqtbx3q_v((int8x16_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev2, 36);
55799 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55800 return __ret;
55801}
55802#endif
55803
55804#ifdef __LITTLE_ENDIAN__
55805__ai uint8x16_t vqtbx3q_u8(uint8x16_t __p0, uint8x16x3_t __p1, uint8x16_t __p2) {
55806 uint8x16_t __ret;
55807 __ret = (uint8x16_t) __builtin_neon_vqtbx3q_v((int8x16_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p1.val[2], (int8x16_t)__p2, 48);
55808 return __ret;
55809}
55810#else
55811__ai uint8x16_t vqtbx3q_u8(uint8x16_t __p0, uint8x16x3_t __p1, uint8x16_t __p2) {
55812 uint8x16_t __ret;
55813 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55814 uint8x16x3_t __rev1;
55815 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55816 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55817 __rev1.val[2] = __builtin_shufflevector(__p1.val[2], __p1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55818 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55819 __ret = (uint8x16_t) __builtin_neon_vqtbx3q_v((int8x16_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev2, 48);
55820 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55821 return __ret;
55822}
5415755823#endif
5415855824
54159#define vld3_f64(__p0) __extension__ ({ \
54160 float64x1x3_t __ret; \
54161 __builtin_neon_vld3_v(&__ret, __p0, 10); \
54162 __ret; \
54163})
54164#define vld3_dup_p64(__p0) __extension__ ({ \
54165 poly64x1x3_t __ret; \
54166 __builtin_neon_vld3_dup_v(&__ret, __p0, 6); \
54167 __ret; \
54168})
5416955825#ifdef __LITTLE_ENDIAN__
54170#define vld3q_dup_p64(__p0) __extension__ ({ \
54171 poly64x2x3_t __ret; \
54172 __builtin_neon_vld3q_dup_v(&__ret, __p0, 38); \
54173 __ret; \
54174})
55826__ai int8x16_t vqtbx3q_s8(int8x16_t __p0, int8x16x3_t __p1, uint8x16_t __p2) {
55827 int8x16_t __ret;
55828 __ret = (int8x16_t) __builtin_neon_vqtbx3q_v((int8x16_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p1.val[2], (int8x16_t)__p2, 32);
55829 return __ret;
55830}
5417555831#else
54176#define vld3q_dup_p64(__p0) __extension__ ({ \
54177 poly64x2x3_t __ret; \
54178 __builtin_neon_vld3q_dup_v(&__ret, __p0, 38); \
54179 \
54180 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
54181 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
54182 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
54183 __ret; \
54184})
55832__ai int8x16_t vqtbx3q_s8(int8x16_t __p0, int8x16x3_t __p1, uint8x16_t __p2) {
55833 int8x16_t __ret;
55834 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55835 int8x16x3_t __rev1;
55836 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55837 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55838 __rev1.val[2] = __builtin_shufflevector(__p1.val[2], __p1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55839 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55840 __ret = (int8x16_t) __builtin_neon_vqtbx3q_v((int8x16_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev2, 32);
55841 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55842 return __ret;
55843}
5418555844#endif
5418655845
5418755846#ifdef __LITTLE_ENDIAN__
54188#define vld3q_dup_f64(__p0) __extension__ ({ \
54189 float64x2x3_t __ret; \
54190 __builtin_neon_vld3q_dup_v(&__ret, __p0, 42); \
54191 __ret; \
54192})
55847__ai uint8x8_t vqtbx3_u8(uint8x8_t __p0, uint8x16x3_t __p1, uint8x8_t __p2) {
55848 uint8x8_t __ret;
55849 __ret = (uint8x8_t) __builtin_neon_vqtbx3_v((int8x8_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p1.val[2], (int8x8_t)__p2, 16);
55850 return __ret;
55851}
5419355852#else
54194#define vld3q_dup_f64(__p0) __extension__ ({ \
54195 float64x2x3_t __ret; \
54196 __builtin_neon_vld3q_dup_v(&__ret, __p0, 42); \
54197 \
54198 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
54199 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
54200 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
54201 __ret; \
54202})
55853__ai uint8x8_t vqtbx3_u8(uint8x8_t __p0, uint8x16x3_t __p1, uint8x8_t __p2) {
55854 uint8x8_t __ret;
55855 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
55856 uint8x16x3_t __rev1;
55857 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55858 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55859 __rev1.val[2] = __builtin_shufflevector(__p1.val[2], __p1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55860 uint8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
55861 __ret = (uint8x8_t) __builtin_neon_vqtbx3_v((int8x8_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x8_t)__rev2, 16);
55862 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
55863 return __ret;
55864}
5420355865#endif
5420455866
54205#define vld3_dup_f64(__p0) __extension__ ({ \
54206 float64x1x3_t __ret; \
54207 __builtin_neon_vld3_dup_v(&__ret, __p0, 10); \
54208 __ret; \
54209})
54210#define vld3_lane_p64(__p0, __p1, __p2) __extension__ ({ \
54211 poly64x1x3_t __ret; \
54212 poly64x1x3_t __s1 = __p1; \
54213 __builtin_neon_vld3_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], __p2, 6); \
54214 __ret; \
54215})
5421655867#ifdef __LITTLE_ENDIAN__
54217#define vld3q_lane_p8(__p0, __p1, __p2) __extension__ ({ \
54218 poly8x16x3_t __ret; \
54219 poly8x16x3_t __s1 = __p1; \
54220 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 36); \
54221 __ret; \
54222})
55868__ai int8x8_t vqtbx3_s8(int8x8_t __p0, int8x16x3_t __p1, uint8x8_t __p2) {
55869 int8x8_t __ret;
55870 __ret = (int8x8_t) __builtin_neon_vqtbx3_v((int8x8_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p1.val[2], (int8x8_t)__p2, 0);
55871 return __ret;
55872}
5422355873#else
54224#define vld3q_lane_p8(__p0, __p1, __p2) __extension__ ({ \
54225 poly8x16x3_t __ret; \
54226 poly8x16x3_t __s1 = __p1; \
54227 poly8x16x3_t __rev1; \
54228 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54229 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54230 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54231 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 36); \
54232 \
54233 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54234 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54235 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54236 __ret; \
54237})
55874__ai int8x8_t vqtbx3_s8(int8x8_t __p0, int8x16x3_t __p1, uint8x8_t __p2) {
55875 int8x8_t __ret;
55876 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
55877 int8x16x3_t __rev1;
55878 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55879 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55880 __rev1.val[2] = __builtin_shufflevector(__p1.val[2], __p1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55881 uint8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
55882 __ret = (int8x8_t) __builtin_neon_vqtbx3_v((int8x8_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x8_t)__rev2, 0);
55883 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
55884 return __ret;
55885}
5423855886#endif
5423955887
5424055888#ifdef __LITTLE_ENDIAN__
54241#define vld3q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
54242 poly64x2x3_t __ret; \
54243 poly64x2x3_t __s1 = __p1; \
54244 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 38); \
54245 __ret; \
54246})
55889__ai poly8x8_t vqtbx4_p8(poly8x8_t __p0, poly8x16x4_t __p1, uint8x8_t __p2) {
55890 poly8x8_t __ret;
55891 __ret = (poly8x8_t) __builtin_neon_vqtbx4_v((int8x8_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p1.val[2], (int8x16_t)__p1.val[3], (int8x8_t)__p2, 4);
55892 return __ret;
55893}
5424755894#else
54248#define vld3q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
54249 poly64x2x3_t __ret; \
54250 poly64x2x3_t __s1 = __p1; \
54251 poly64x2x3_t __rev1; \
54252 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
54253 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
54254 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
54255 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 38); \
54256 \
54257 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
54258 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
54259 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
54260 __ret; \
54261})
55895__ai poly8x8_t vqtbx4_p8(poly8x8_t __p0, poly8x16x4_t __p1, uint8x8_t __p2) {
55896 poly8x8_t __ret;
55897 poly8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
55898 poly8x16x4_t __rev1;
55899 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55900 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55901 __rev1.val[2] = __builtin_shufflevector(__p1.val[2], __p1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55902 __rev1.val[3] = __builtin_shufflevector(__p1.val[3], __p1.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55903 uint8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
55904 __ret = (poly8x8_t) __builtin_neon_vqtbx4_v((int8x8_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], (int8x8_t)__rev2, 4);
55905 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
55906 return __ret;
55907}
5426255908#endif
5426355909
5426455910#ifdef __LITTLE_ENDIAN__
54265#define vld3q_lane_u8(__p0, __p1, __p2) __extension__ ({ \
54266 uint8x16x3_t __ret; \
54267 uint8x16x3_t __s1 = __p1; \
54268 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 48); \
54269 __ret; \
54270})
55911__ai poly8x16_t vqtbx4q_p8(poly8x16_t __p0, poly8x16x4_t __p1, uint8x16_t __p2) {
55912 poly8x16_t __ret;
55913 __ret = (poly8x16_t) __builtin_neon_vqtbx4q_v((int8x16_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p1.val[2], (int8x16_t)__p1.val[3], (int8x16_t)__p2, 36);
55914 return __ret;
55915}
5427155916#else
54272#define vld3q_lane_u8(__p0, __p1, __p2) __extension__ ({ \
54273 uint8x16x3_t __ret; \
54274 uint8x16x3_t __s1 = __p1; \
54275 uint8x16x3_t __rev1; \
54276 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54277 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54278 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54279 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 48); \
54280 \
54281 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54282 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54283 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54284 __ret; \
54285})
55917__ai poly8x16_t vqtbx4q_p8(poly8x16_t __p0, poly8x16x4_t __p1, uint8x16_t __p2) {
55918 poly8x16_t __ret;
55919 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55920 poly8x16x4_t __rev1;
55921 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55922 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55923 __rev1.val[2] = __builtin_shufflevector(__p1.val[2], __p1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55924 __rev1.val[3] = __builtin_shufflevector(__p1.val[3], __p1.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55925 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55926 __ret = (poly8x16_t) __builtin_neon_vqtbx4q_v((int8x16_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], (int8x16_t)__rev2, 36);
55927 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55928 return __ret;
55929}
5428655930#endif
5428755931
5428855932#ifdef __LITTLE_ENDIAN__
54289#define vld3q_lane_u64(__p0, __p1, __p2) __extension__ ({ \
54290 uint64x2x3_t __ret; \
54291 uint64x2x3_t __s1 = __p1; \
54292 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 51); \
54293 __ret; \
54294})
55933__ai uint8x16_t vqtbx4q_u8(uint8x16_t __p0, uint8x16x4_t __p1, uint8x16_t __p2) {
55934 uint8x16_t __ret;
55935 __ret = (uint8x16_t) __builtin_neon_vqtbx4q_v((int8x16_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p1.val[2], (int8x16_t)__p1.val[3], (int8x16_t)__p2, 48);
55936 return __ret;
55937}
5429555938#else
54296#define vld3q_lane_u64(__p0, __p1, __p2) __extension__ ({ \
54297 uint64x2x3_t __ret; \
54298 uint64x2x3_t __s1 = __p1; \
54299 uint64x2x3_t __rev1; \
54300 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
54301 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
54302 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
54303 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 51); \
54304 \
54305 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
54306 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
54307 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
54308 __ret; \
54309})
55939__ai uint8x16_t vqtbx4q_u8(uint8x16_t __p0, uint8x16x4_t __p1, uint8x16_t __p2) {
55940 uint8x16_t __ret;
55941 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55942 uint8x16x4_t __rev1;
55943 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55944 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55945 __rev1.val[2] = __builtin_shufflevector(__p1.val[2], __p1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55946 __rev1.val[3] = __builtin_shufflevector(__p1.val[3], __p1.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55947 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55948 __ret = (uint8x16_t) __builtin_neon_vqtbx4q_v((int8x16_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], (int8x16_t)__rev2, 48);
55949 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55950 return __ret;
55951}
5431055952#endif
5431155953
5431255954#ifdef __LITTLE_ENDIAN__
54313#define vld3q_lane_s8(__p0, __p1, __p2) __extension__ ({ \
54314 int8x16x3_t __ret; \
54315 int8x16x3_t __s1 = __p1; \
54316 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 32); \
54317 __ret; \
54318})
55955__ai int8x16_t vqtbx4q_s8(int8x16_t __p0, int8x16x4_t __p1, uint8x16_t __p2) {
55956 int8x16_t __ret;
55957 __ret = (int8x16_t) __builtin_neon_vqtbx4q_v((int8x16_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p1.val[2], (int8x16_t)__p1.val[3], (int8x16_t)__p2, 32);
55958 return __ret;
55959}
5431955960#else
54320#define vld3q_lane_s8(__p0, __p1, __p2) __extension__ ({ \
54321 int8x16x3_t __ret; \
54322 int8x16x3_t __s1 = __p1; \
54323 int8x16x3_t __rev1; \
54324 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54325 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54326 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54327 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 32); \
54328 \
54329 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54330 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54331 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54332 __ret; \
54333})
55961__ai int8x16_t vqtbx4q_s8(int8x16_t __p0, int8x16x4_t __p1, uint8x16_t __p2) {
55962 int8x16_t __ret;
55963 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55964 int8x16x4_t __rev1;
55965 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55966 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55967 __rev1.val[2] = __builtin_shufflevector(__p1.val[2], __p1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55968 __rev1.val[3] = __builtin_shufflevector(__p1.val[3], __p1.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55969 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55970 __ret = (int8x16_t) __builtin_neon_vqtbx4q_v((int8x16_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], (int8x16_t)__rev2, 32);
55971 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55972 return __ret;
55973}
5433455974#endif
5433555975
5433655976#ifdef __LITTLE_ENDIAN__
54337#define vld3q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
54338 float64x2x3_t __ret; \
54339 float64x2x3_t __s1 = __p1; \
54340 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 42); \
54341 __ret; \
54342})
55977__ai uint8x8_t vqtbx4_u8(uint8x8_t __p0, uint8x16x4_t __p1, uint8x8_t __p2) {
55978 uint8x8_t __ret;
55979 __ret = (uint8x8_t) __builtin_neon_vqtbx4_v((int8x8_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p1.val[2], (int8x16_t)__p1.val[3], (int8x8_t)__p2, 16);
55980 return __ret;
55981}
5434355982#else
54344#define vld3q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
54345 float64x2x3_t __ret; \
54346 float64x2x3_t __s1 = __p1; \
54347 float64x2x3_t __rev1; \
54348 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
54349 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
54350 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
54351 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 42); \
54352 \
54353 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
54354 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
54355 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
54356 __ret; \
54357})
55983__ai uint8x8_t vqtbx4_u8(uint8x8_t __p0, uint8x16x4_t __p1, uint8x8_t __p2) {
55984 uint8x8_t __ret;
55985 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
55986 uint8x16x4_t __rev1;
55987 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55988 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55989 __rev1.val[2] = __builtin_shufflevector(__p1.val[2], __p1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55990 __rev1.val[3] = __builtin_shufflevector(__p1.val[3], __p1.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55991 uint8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
55992 __ret = (uint8x8_t) __builtin_neon_vqtbx4_v((int8x8_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], (int8x8_t)__rev2, 16);
55993 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
55994 return __ret;
55995}
5435855996#endif
5435955997
5436055998#ifdef __LITTLE_ENDIAN__
54361#define vld3q_lane_s64(__p0, __p1, __p2) __extension__ ({ \
54362 int64x2x3_t __ret; \
54363 int64x2x3_t __s1 = __p1; \
54364 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 35); \
54365 __ret; \
54366})
55999__ai int8x8_t vqtbx4_s8(int8x8_t __p0, int8x16x4_t __p1, uint8x8_t __p2) {
56000 int8x8_t __ret;
56001 __ret = (int8x8_t) __builtin_neon_vqtbx4_v((int8x8_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p1.val[2], (int8x16_t)__p1.val[3], (int8x8_t)__p2, 0);
56002 return __ret;
56003}
5436756004#else
54368#define vld3q_lane_s64(__p0, __p1, __p2) __extension__ ({ \
54369 int64x2x3_t __ret; \
54370 int64x2x3_t __s1 = __p1; \
54371 int64x2x3_t __rev1; \
54372 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
54373 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
54374 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
54375 __builtin_neon_vld3q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 35); \
54376 \
54377 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
54378 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
54379 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
54380 __ret; \
54381})
56005__ai int8x8_t vqtbx4_s8(int8x8_t __p0, int8x16x4_t __p1, uint8x8_t __p2) {
56006 int8x8_t __ret;
56007 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
56008 int8x16x4_t __rev1;
56009 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
56010 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
56011 __rev1.val[2] = __builtin_shufflevector(__p1.val[2], __p1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
56012 __rev1.val[3] = __builtin_shufflevector(__p1.val[3], __p1.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
56013 uint8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
56014 __ret = (int8x8_t) __builtin_neon_vqtbx4_v((int8x8_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], (int8x8_t)__rev2, 0);
56015 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
56016 return __ret;
56017}
5438256018#endif
5438356019
54384#define vld3_lane_u64(__p0, __p1, __p2) __extension__ ({ \
54385 uint64x1x3_t __ret; \
54386 uint64x1x3_t __s1 = __p1; \
54387 __builtin_neon_vld3_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], __p2, 19); \
54388 __ret; \
54389})
54390#define vld3_lane_f64(__p0, __p1, __p2) __extension__ ({ \
54391 float64x1x3_t __ret; \
54392 float64x1x3_t __s1 = __p1; \
54393 __builtin_neon_vld3_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], __p2, 10); \
54394 __ret; \
54395})
54396#define vld3_lane_s64(__p0, __p1, __p2) __extension__ ({ \
54397 int64x1x3_t __ret; \
54398 int64x1x3_t __s1 = __p1; \
54399 __builtin_neon_vld3_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], __p2, 3); \
54400 __ret; \
54401})
54402#define vld4_p64(__p0) __extension__ ({ \
54403 poly64x1x4_t __ret; \
54404 __builtin_neon_vld4_v(&__ret, __p0, 6); \
54405 __ret; \
54406})
5440756020#ifdef __LITTLE_ENDIAN__
54408#define vld4q_p64(__p0) __extension__ ({ \
54409 poly64x2x4_t __ret; \
54410 __builtin_neon_vld4q_v(&__ret, __p0, 38); \
54411 __ret; \
54412})
56021__ai uint16x8_t vraddhn_high_u32(uint16x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
56022 uint16x8_t __ret;
56023 __ret = vcombine_u16(__p0, vraddhn_u32(__p1, __p2));
56024 return __ret;
56025}
5441356026#else
54414#define vld4q_p64(__p0) __extension__ ({ \
54415 poly64x2x4_t __ret; \
54416 __builtin_neon_vld4q_v(&__ret, __p0, 38); \
54417 \
54418 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
54419 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
54420 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
54421 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 1, 0); \
54422 __ret; \
54423})
56027__ai uint16x8_t vraddhn_high_u32(uint16x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
56028 uint16x8_t __ret;
56029 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
56030 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
56031 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
56032 __ret = __noswap_vcombine_u16(__rev0, __noswap_vraddhn_u32(__rev1, __rev2));
56033 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
56034 return __ret;
56035}
5442456036#endif
5442556037
5442656038#ifdef __LITTLE_ENDIAN__
54427#define vld4q_u64(__p0) __extension__ ({ \
54428 uint64x2x4_t __ret; \
54429 __builtin_neon_vld4q_v(&__ret, __p0, 51); \
54430 __ret; \
54431})
56039__ai uint32x4_t vraddhn_high_u64(uint32x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
56040 uint32x4_t __ret;
56041 __ret = vcombine_u32(__p0, vraddhn_u64(__p1, __p2));
56042 return __ret;
56043}
5443256044#else
54433#define vld4q_u64(__p0) __extension__ ({ \
54434 uint64x2x4_t __ret; \
54435 __builtin_neon_vld4q_v(&__ret, __p0, 51); \
54436 \
54437 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
54438 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
54439 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
54440 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 1, 0); \
54441 __ret; \
54442})
56045__ai uint32x4_t vraddhn_high_u64(uint32x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
56046 uint32x4_t __ret;
56047 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
56048 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
56049 uint64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
56050 __ret = __noswap_vcombine_u32(__rev0, __noswap_vraddhn_u64(__rev1, __rev2));
56051 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
56052 return __ret;
56053}
5444356054#endif
5444456055
5444556056#ifdef __LITTLE_ENDIAN__
54446#define vld4q_f64(__p0) __extension__ ({ \
54447 float64x2x4_t __ret; \
54448 __builtin_neon_vld4q_v(&__ret, __p0, 42); \
54449 __ret; \
54450})
56057__ai uint8x16_t vraddhn_high_u16(uint8x8_t __p0, uint16x8_t __p1, uint16x8_t __p2) {
56058 uint8x16_t __ret;
56059 __ret = vcombine_u8(__p0, vraddhn_u16(__p1, __p2));
56060 return __ret;
56061}
5445156062#else
54452#define vld4q_f64(__p0) __extension__ ({ \
54453 float64x2x4_t __ret; \
54454 __builtin_neon_vld4q_v(&__ret, __p0, 42); \
54455 \
54456 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
54457 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
54458 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
54459 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 1, 0); \
54460 __ret; \
54461})
56063__ai uint8x16_t vraddhn_high_u16(uint8x8_t __p0, uint16x8_t __p1, uint16x8_t __p2) {
56064 uint8x16_t __ret;
56065 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
56066 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
56067 uint16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
56068 __ret = __noswap_vcombine_u8(__rev0, __noswap_vraddhn_u16(__rev1, __rev2));
56069 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
56070 return __ret;
56071}
5446256072#endif
5446356073
5446456074#ifdef __LITTLE_ENDIAN__
54465#define vld4q_s64(__p0) __extension__ ({ \
54466 int64x2x4_t __ret; \
54467 __builtin_neon_vld4q_v(&__ret, __p0, 35); \
54468 __ret; \
54469})
56075__ai int16x8_t vraddhn_high_s32(int16x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
56076 int16x8_t __ret;
56077 __ret = vcombine_s16(__p0, vraddhn_s32(__p1, __p2));
56078 return __ret;
56079}
5447056080#else
54471#define vld4q_s64(__p0) __extension__ ({ \
54472 int64x2x4_t __ret; \
54473 __builtin_neon_vld4q_v(&__ret, __p0, 35); \
54474 \
54475 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
54476 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
54477 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
54478 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 1, 0); \
54479 __ret; \
54480})
56081__ai int16x8_t vraddhn_high_s32(int16x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
56082 int16x8_t __ret;
56083 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
56084 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
56085 int32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
56086 __ret = __noswap_vcombine_s16(__rev0, __noswap_vraddhn_s32(__rev1, __rev2));
56087 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
56088 return __ret;
56089}
5448156090#endif
5448256091
54483#define vld4_f64(__p0) __extension__ ({ \
54484 float64x1x4_t __ret; \
54485 __builtin_neon_vld4_v(&__ret, __p0, 10); \
54486 __ret; \
54487})
54488#define vld4_dup_p64(__p0) __extension__ ({ \
54489 poly64x1x4_t __ret; \
54490 __builtin_neon_vld4_dup_v(&__ret, __p0, 6); \
54491 __ret; \
54492})
5449356092#ifdef __LITTLE_ENDIAN__
54494#define vld4q_dup_p64(__p0) __extension__ ({ \
54495 poly64x2x4_t __ret; \
54496 __builtin_neon_vld4q_dup_v(&__ret, __p0, 38); \
54497 __ret; \
54498})
54499#else
54500#define vld4q_dup_p64(__p0) __extension__ ({ \
54501 poly64x2x4_t __ret; \
54502 __builtin_neon_vld4q_dup_v(&__ret, __p0, 38); \
54503 \
54504 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
54505 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
54506 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
54507 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 1, 0); \
54508 __ret; \
54509})
56093__ai int32x4_t vraddhn_high_s64(int32x2_t __p0, int64x2_t __p1, int64x2_t __p2) {
56094 int32x4_t __ret;
56095 __ret = vcombine_s32(__p0, vraddhn_s64(__p1, __p2));
56096 return __ret;
56097}
56098#else
56099__ai int32x4_t vraddhn_high_s64(int32x2_t __p0, int64x2_t __p1, int64x2_t __p2) {
56100 int32x4_t __ret;
56101 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
56102 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
56103 int64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
56104 __ret = __noswap_vcombine_s32(__rev0, __noswap_vraddhn_s64(__rev1, __rev2));
56105 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
56106 return __ret;
56107}
5451056108#endif
5451156109
5451256110#ifdef __LITTLE_ENDIAN__
54513#define vld4q_dup_f64(__p0) __extension__ ({ \
54514 float64x2x4_t __ret; \
54515 __builtin_neon_vld4q_dup_v(&__ret, __p0, 42); \
54516 __ret; \
54517})
56111__ai int8x16_t vraddhn_high_s16(int8x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
56112 int8x16_t __ret;
56113 __ret = vcombine_s8(__p0, vraddhn_s16(__p1, __p2));
56114 return __ret;
56115}
5451856116#else
54519#define vld4q_dup_f64(__p0) __extension__ ({ \
54520 float64x2x4_t __ret; \
54521 __builtin_neon_vld4q_dup_v(&__ret, __p0, 42); \
54522 \
54523 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
54524 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
54525 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
54526 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 1, 0); \
54527 __ret; \
54528})
56117__ai int8x16_t vraddhn_high_s16(int8x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
56118 int8x16_t __ret;
56119 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
56120 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
56121 int16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
56122 __ret = __noswap_vcombine_s8(__rev0, __noswap_vraddhn_s16(__rev1, __rev2));
56123 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
56124 return __ret;
56125}
5452956126#endif
5453056127
54531#define vld4_dup_f64(__p0) __extension__ ({ \
54532 float64x1x4_t __ret; \
54533 __builtin_neon_vld4_dup_v(&__ret, __p0, 10); \
54534 __ret; \
54535})
54536#define vld4_lane_p64(__p0, __p1, __p2) __extension__ ({ \
54537 poly64x1x4_t __ret; \
54538 poly64x1x4_t __s1 = __p1; \
54539 __builtin_neon_vld4_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], __p2, 6); \
54540 __ret; \
54541})
5454256128#ifdef __LITTLE_ENDIAN__
54543#define vld4q_lane_p8(__p0, __p1, __p2) __extension__ ({ \
54544 poly8x16x4_t __ret; \
54545 poly8x16x4_t __s1 = __p1; \
54546 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 36); \
54547 __ret; \
54548})
56129__ai poly8x8_t vrbit_p8(poly8x8_t __p0) {
56130 poly8x8_t __ret;
56131 __ret = (poly8x8_t) __builtin_neon_vrbit_v((int8x8_t)__p0, 4);
56132 return __ret;
56133}
5454956134#else
54550#define vld4q_lane_p8(__p0, __p1, __p2) __extension__ ({ \
54551 poly8x16x4_t __ret; \
54552 poly8x16x4_t __s1 = __p1; \
54553 poly8x16x4_t __rev1; \
54554 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54555 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54556 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54557 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54558 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 36); \
54559 \
54560 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54561 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54562 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54563 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54564 __ret; \
54565})
56135__ai poly8x8_t vrbit_p8(poly8x8_t __p0) {
56136 poly8x8_t __ret;
56137 poly8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
56138 __ret = (poly8x8_t) __builtin_neon_vrbit_v((int8x8_t)__rev0, 4);
56139 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
56140 return __ret;
56141}
5456656142#endif
5456756143
5456856144#ifdef __LITTLE_ENDIAN__
54569#define vld4q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
54570 poly64x2x4_t __ret; \
54571 poly64x2x4_t __s1 = __p1; \
54572 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 38); \
54573 __ret; \
54574})
56145__ai poly8x16_t vrbitq_p8(poly8x16_t __p0) {
56146 poly8x16_t __ret;
56147 __ret = (poly8x16_t) __builtin_neon_vrbitq_v((int8x16_t)__p0, 36);
56148 return __ret;
56149}
5457556150#else
54576#define vld4q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
54577 poly64x2x4_t __ret; \
54578 poly64x2x4_t __s1 = __p1; \
54579 poly64x2x4_t __rev1; \
54580 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
54581 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
54582 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
54583 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 1, 0); \
54584 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 38); \
54585 \
54586 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
54587 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
54588 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
54589 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 1, 0); \
54590 __ret; \
54591})
56151__ai poly8x16_t vrbitq_p8(poly8x16_t __p0) {
56152 poly8x16_t __ret;
56153 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
56154 __ret = (poly8x16_t) __builtin_neon_vrbitq_v((int8x16_t)__rev0, 36);
56155 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
56156 return __ret;
56157}
5459256158#endif
5459356159
5459456160#ifdef __LITTLE_ENDIAN__
54595#define vld4q_lane_u8(__p0, __p1, __p2) __extension__ ({ \
54596 uint8x16x4_t __ret; \
54597 uint8x16x4_t __s1 = __p1; \
54598 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 48); \
54599 __ret; \
54600})
56161__ai uint8x16_t vrbitq_u8(uint8x16_t __p0) {
56162 uint8x16_t __ret;
56163 __ret = (uint8x16_t) __builtin_neon_vrbitq_v((int8x16_t)__p0, 48);
56164 return __ret;
56165}
5460156166#else
54602#define vld4q_lane_u8(__p0, __p1, __p2) __extension__ ({ \
54603 uint8x16x4_t __ret; \
54604 uint8x16x4_t __s1 = __p1; \
54605 uint8x16x4_t __rev1; \
54606 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54607 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54608 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54609 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54610 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 48); \
54611 \
54612 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54613 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54614 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54615 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54616 __ret; \
54617})
56167__ai uint8x16_t vrbitq_u8(uint8x16_t __p0) {
56168 uint8x16_t __ret;
56169 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
56170 __ret = (uint8x16_t) __builtin_neon_vrbitq_v((int8x16_t)__rev0, 48);
56171 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
56172 return __ret;
56173}
5461856174#endif
5461956175
5462056176#ifdef __LITTLE_ENDIAN__
54621#define vld4q_lane_u64(__p0, __p1, __p2) __extension__ ({ \
54622 uint64x2x4_t __ret; \
54623 uint64x2x4_t __s1 = __p1; \
54624 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 51); \
54625 __ret; \
54626})
56177__ai int8x16_t vrbitq_s8(int8x16_t __p0) {
56178 int8x16_t __ret;
56179 __ret = (int8x16_t) __builtin_neon_vrbitq_v((int8x16_t)__p0, 32);
56180 return __ret;
56181}
5462756182#else
54628#define vld4q_lane_u64(__p0, __p1, __p2) __extension__ ({ \
54629 uint64x2x4_t __ret; \
54630 uint64x2x4_t __s1 = __p1; \
54631 uint64x2x4_t __rev1; \
54632 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
54633 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
54634 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
54635 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 1, 0); \
54636 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 51); \
54637 \
54638 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
54639 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
54640 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
54641 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 1, 0); \
54642 __ret; \
54643})
56183__ai int8x16_t vrbitq_s8(int8x16_t __p0) {
56184 int8x16_t __ret;
56185 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
56186 __ret = (int8x16_t) __builtin_neon_vrbitq_v((int8x16_t)__rev0, 32);
56187 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
56188 return __ret;
56189}
5464456190#endif
5464556191
5464656192#ifdef __LITTLE_ENDIAN__
54647#define vld4q_lane_s8(__p0, __p1, __p2) __extension__ ({ \
54648 int8x16x4_t __ret; \
54649 int8x16x4_t __s1 = __p1; \
54650 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 32); \
54651 __ret; \
54652})
56193__ai uint8x8_t vrbit_u8(uint8x8_t __p0) {
56194 uint8x8_t __ret;
56195 __ret = (uint8x8_t) __builtin_neon_vrbit_v((int8x8_t)__p0, 16);
56196 return __ret;
56197}
5465356198#else
54654#define vld4q_lane_s8(__p0, __p1, __p2) __extension__ ({ \
54655 int8x16x4_t __ret; \
54656 int8x16x4_t __s1 = __p1; \
54657 int8x16x4_t __rev1; \
54658 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54659 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54660 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54661 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54662 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 32); \
54663 \
54664 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54665 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54666 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54667 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
54668 __ret; \
54669})
56199__ai uint8x8_t vrbit_u8(uint8x8_t __p0) {
56200 uint8x8_t __ret;
56201 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
56202 __ret = (uint8x8_t) __builtin_neon_vrbit_v((int8x8_t)__rev0, 16);
56203 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
56204 return __ret;
56205}
5467056206#endif
5467156207
5467256208#ifdef __LITTLE_ENDIAN__
54673#define vld4q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
54674 float64x2x4_t __ret; \
54675 float64x2x4_t __s1 = __p1; \
54676 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 42); \
54677 __ret; \
54678})
56209__ai int8x8_t vrbit_s8(int8x8_t __p0) {
56210 int8x8_t __ret;
56211 __ret = (int8x8_t) __builtin_neon_vrbit_v((int8x8_t)__p0, 0);
56212 return __ret;
56213}
5467956214#else
54680#define vld4q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
54681 float64x2x4_t __ret; \
54682 float64x2x4_t __s1 = __p1; \
54683 float64x2x4_t __rev1; \
54684 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
54685 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
54686 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
54687 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 1, 0); \
54688 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 42); \
54689 \
54690 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
54691 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
54692 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
54693 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 1, 0); \
54694 __ret; \
54695})
56215__ai int8x8_t vrbit_s8(int8x8_t __p0) {
56216 int8x8_t __ret;
56217 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
56218 __ret = (int8x8_t) __builtin_neon_vrbit_v((int8x8_t)__rev0, 0);
56219 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
56220 return __ret;
56221}
5469656222#endif
5469756223
5469856224#ifdef __LITTLE_ENDIAN__
54699#define vld4q_lane_s64(__p0, __p1, __p2) __extension__ ({ \
54700 int64x2x4_t __ret; \
54701 int64x2x4_t __s1 = __p1; \
54702 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 35); \
54703 __ret; \
54704})
56225__ai float64x2_t vrecpeq_f64(float64x2_t __p0) {
56226 float64x2_t __ret;
56227 __ret = (float64x2_t) __builtin_neon_vrecpeq_v((int8x16_t)__p0, 42);
56228 return __ret;
56229}
5470556230#else
54706#define vld4q_lane_s64(__p0, __p1, __p2) __extension__ ({ \
54707 int64x2x4_t __ret; \
54708 int64x2x4_t __s1 = __p1; \
54709 int64x2x4_t __rev1; \
54710 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
54711 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
54712 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
54713 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 1, 0); \
54714 __builtin_neon_vld4q_lane_v(&__ret, __p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 35); \
54715 \
54716 __ret.val[0] = __builtin_shufflevector(__ret.val[0], __ret.val[0], 1, 0); \
54717 __ret.val[1] = __builtin_shufflevector(__ret.val[1], __ret.val[1], 1, 0); \
54718 __ret.val[2] = __builtin_shufflevector(__ret.val[2], __ret.val[2], 1, 0); \
54719 __ret.val[3] = __builtin_shufflevector(__ret.val[3], __ret.val[3], 1, 0); \
54720 __ret; \
54721})
56231__ai float64x2_t vrecpeq_f64(float64x2_t __p0) {
56232 float64x2_t __ret;
56233 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
56234 __ret = (float64x2_t) __builtin_neon_vrecpeq_v((int8x16_t)__rev0, 42);
56235 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
56236 return __ret;
56237}
5472256238#endif
5472356239
54724#define vld4_lane_u64(__p0, __p1, __p2) __extension__ ({ \
54725 uint64x1x4_t __ret; \
54726 uint64x1x4_t __s1 = __p1; \
54727 __builtin_neon_vld4_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], __p2, 19); \
54728 __ret; \
54729})
54730#define vld4_lane_f64(__p0, __p1, __p2) __extension__ ({ \
54731 float64x1x4_t __ret; \
54732 float64x1x4_t __s1 = __p1; \
54733 __builtin_neon_vld4_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], __p2, 10); \
54734 __ret; \
54735})
54736#define vld4_lane_s64(__p0, __p1, __p2) __extension__ ({ \
54737 int64x1x4_t __ret; \
54738 int64x1x4_t __s1 = __p1; \
54739 __builtin_neon_vld4_lane_v(&__ret, __p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], __p2, 3); \
54740 __ret; \
54741})
54742#define vldrq_p128(__p0) __extension__ ({ \
54743 poly128_t __ret; \
54744 __ret = (poly128_t) __builtin_neon_vldrq_p128(__p0); \
54745 __ret; \
54746})
56240__ai float64x1_t vrecpe_f64(float64x1_t __p0) {
56241 float64x1_t __ret;
56242 __ret = (float64x1_t) __builtin_neon_vrecpe_v((int8x8_t)__p0, 10);
56243 return __ret;
56244}
56245__ai float64_t vrecped_f64(float64_t __p0) {
56246 float64_t __ret;
56247 __ret = (float64_t) __builtin_neon_vrecped_f64(__p0);
56248 return __ret;
56249}
56250__ai float32_t vrecpes_f32(float32_t __p0) {
56251 float32_t __ret;
56252 __ret = (float32_t) __builtin_neon_vrecpes_f32(__p0);
56253 return __ret;
56254}
5474756255#ifdef __LITTLE_ENDIAN__
54748__ai float64x2_t vmaxq_f64(float64x2_t __p0, float64x2_t __p1) {
56256__ai float64x2_t vrecpsq_f64(float64x2_t __p0, float64x2_t __p1) {
5474956257 float64x2_t __ret;
54750 __ret = (float64x2_t) __builtin_neon_vmaxq_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
56258 __ret = (float64x2_t) __builtin_neon_vrecpsq_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
56259 return __ret;
56260}
56261#else
56262__ai float64x2_t vrecpsq_f64(float64x2_t __p0, float64x2_t __p1) {
56263 float64x2_t __ret;
56264 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
56265 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
56266 __ret = (float64x2_t) __builtin_neon_vrecpsq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
56267 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
56268 return __ret;
56269}
56270#endif
56271
56272__ai float64x1_t vrecps_f64(float64x1_t __p0, float64x1_t __p1) {
56273 float64x1_t __ret;
56274 __ret = (float64x1_t) __builtin_neon_vrecps_v((int8x8_t)__p0, (int8x8_t)__p1, 10);
56275 return __ret;
56276}
56277__ai float64_t vrecpsd_f64(float64_t __p0, float64_t __p1) {
56278 float64_t __ret;
56279 __ret = (float64_t) __builtin_neon_vrecpsd_f64(__p0, __p1);
56280 return __ret;
56281}
56282__ai float32_t vrecpss_f32(float32_t __p0, float32_t __p1) {
56283 float32_t __ret;
56284 __ret = (float32_t) __builtin_neon_vrecpss_f32(__p0, __p1);
56285 return __ret;
56286}
56287__ai float64_t vrecpxd_f64(float64_t __p0) {
56288 float64_t __ret;
56289 __ret = (float64_t) __builtin_neon_vrecpxd_f64(__p0);
56290 return __ret;
56291}
56292__ai float32_t vrecpxs_f32(float32_t __p0) {
56293 float32_t __ret;
56294 __ret = (float32_t) __builtin_neon_vrecpxs_f32(__p0);
56295 return __ret;
56296}
56297__ai poly8x8_t vreinterpret_p8_p64(poly64x1_t __p0) {
56298 poly8x8_t __ret;
56299 __ret = (poly8x8_t)(__p0);
56300 return __ret;
56301}
56302__ai poly8x8_t vreinterpret_p8_p16(poly16x4_t __p0) {
56303 poly8x8_t __ret;
56304 __ret = (poly8x8_t)(__p0);
56305 return __ret;
56306}
56307__ai poly8x8_t vreinterpret_p8_u8(uint8x8_t __p0) {
56308 poly8x8_t __ret;
56309 __ret = (poly8x8_t)(__p0);
56310 return __ret;
56311}
56312__ai poly8x8_t vreinterpret_p8_u32(uint32x2_t __p0) {
56313 poly8x8_t __ret;
56314 __ret = (poly8x8_t)(__p0);
56315 return __ret;
56316}
56317__ai poly8x8_t vreinterpret_p8_u64(uint64x1_t __p0) {
56318 poly8x8_t __ret;
56319 __ret = (poly8x8_t)(__p0);
56320 return __ret;
56321}
56322__ai poly8x8_t vreinterpret_p8_u16(uint16x4_t __p0) {
56323 poly8x8_t __ret;
56324 __ret = (poly8x8_t)(__p0);
56325 return __ret;
56326}
56327__ai poly8x8_t vreinterpret_p8_s8(int8x8_t __p0) {
56328 poly8x8_t __ret;
56329 __ret = (poly8x8_t)(__p0);
56330 return __ret;
56331}
56332__ai poly8x8_t vreinterpret_p8_f64(float64x1_t __p0) {
56333 poly8x8_t __ret;
56334 __ret = (poly8x8_t)(__p0);
56335 return __ret;
56336}
56337__ai poly8x8_t vreinterpret_p8_f32(float32x2_t __p0) {
56338 poly8x8_t __ret;
56339 __ret = (poly8x8_t)(__p0);
56340 return __ret;
56341}
56342__ai poly8x8_t vreinterpret_p8_f16(float16x4_t __p0) {
56343 poly8x8_t __ret;
56344 __ret = (poly8x8_t)(__p0);
56345 return __ret;
56346}
56347__ai poly8x8_t vreinterpret_p8_s32(int32x2_t __p0) {
56348 poly8x8_t __ret;
56349 __ret = (poly8x8_t)(__p0);
56350 return __ret;
56351}
56352__ai poly8x8_t vreinterpret_p8_s64(int64x1_t __p0) {
56353 poly8x8_t __ret;
56354 __ret = (poly8x8_t)(__p0);
56355 return __ret;
56356}
56357__ai poly8x8_t vreinterpret_p8_s16(int16x4_t __p0) {
56358 poly8x8_t __ret;
56359 __ret = (poly8x8_t)(__p0);
56360 return __ret;
56361}
56362__ai poly64x1_t vreinterpret_p64_p8(poly8x8_t __p0) {
56363 poly64x1_t __ret;
56364 __ret = (poly64x1_t)(__p0);
56365 return __ret;
56366}
56367__ai poly64x1_t vreinterpret_p64_p16(poly16x4_t __p0) {
56368 poly64x1_t __ret;
56369 __ret = (poly64x1_t)(__p0);
56370 return __ret;
56371}
56372__ai poly64x1_t vreinterpret_p64_u8(uint8x8_t __p0) {
56373 poly64x1_t __ret;
56374 __ret = (poly64x1_t)(__p0);
56375 return __ret;
56376}
56377__ai poly64x1_t vreinterpret_p64_u32(uint32x2_t __p0) {
56378 poly64x1_t __ret;
56379 __ret = (poly64x1_t)(__p0);
56380 return __ret;
56381}
56382__ai poly64x1_t vreinterpret_p64_u64(uint64x1_t __p0) {
56383 poly64x1_t __ret;
56384 __ret = (poly64x1_t)(__p0);
56385 return __ret;
56386}
56387__ai poly64x1_t vreinterpret_p64_u16(uint16x4_t __p0) {
56388 poly64x1_t __ret;
56389 __ret = (poly64x1_t)(__p0);
56390 return __ret;
56391}
56392__ai poly64x1_t vreinterpret_p64_s8(int8x8_t __p0) {
56393 poly64x1_t __ret;
56394 __ret = (poly64x1_t)(__p0);
56395 return __ret;
56396}
56397__ai poly64x1_t vreinterpret_p64_f64(float64x1_t __p0) {
56398 poly64x1_t __ret;
56399 __ret = (poly64x1_t)(__p0);
56400 return __ret;
56401}
56402__ai poly64x1_t vreinterpret_p64_f32(float32x2_t __p0) {
56403 poly64x1_t __ret;
56404 __ret = (poly64x1_t)(__p0);
56405 return __ret;
56406}
56407__ai poly64x1_t vreinterpret_p64_f16(float16x4_t __p0) {
56408 poly64x1_t __ret;
56409 __ret = (poly64x1_t)(__p0);
56410 return __ret;
56411}
56412__ai poly64x1_t vreinterpret_p64_s32(int32x2_t __p0) {
56413 poly64x1_t __ret;
56414 __ret = (poly64x1_t)(__p0);
56415 return __ret;
56416}
56417__ai poly64x1_t vreinterpret_p64_s64(int64x1_t __p0) {
56418 poly64x1_t __ret;
56419 __ret = (poly64x1_t)(__p0);
56420 return __ret;
56421}
56422__ai poly64x1_t vreinterpret_p64_s16(int16x4_t __p0) {
56423 poly64x1_t __ret;
56424 __ret = (poly64x1_t)(__p0);
56425 return __ret;
56426}
56427__ai poly16x4_t vreinterpret_p16_p8(poly8x8_t __p0) {
56428 poly16x4_t __ret;
56429 __ret = (poly16x4_t)(__p0);
56430 return __ret;
56431}
56432__ai poly16x4_t vreinterpret_p16_p64(poly64x1_t __p0) {
56433 poly16x4_t __ret;
56434 __ret = (poly16x4_t)(__p0);
56435 return __ret;
56436}
56437__ai poly16x4_t vreinterpret_p16_u8(uint8x8_t __p0) {
56438 poly16x4_t __ret;
56439 __ret = (poly16x4_t)(__p0);
5475156440 return __ret;
5475256441}
54753#else
54754__ai float64x2_t vmaxq_f64(float64x2_t __p0, float64x2_t __p1) {
54755 float64x2_t __ret;
54756 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
54757 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
54758 __ret = (float64x2_t) __builtin_neon_vmaxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
54759 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
56442__ai poly16x4_t vreinterpret_p16_u32(uint32x2_t __p0) {
56443 poly16x4_t __ret;
56444 __ret = (poly16x4_t)(__p0);
5476056445 return __ret;
5476156446}
54762#endif
54763
54764__ai float64x1_t vmax_f64(float64x1_t __p0, float64x1_t __p1) {
54765 float64x1_t __ret;
54766 __ret = (float64x1_t) __builtin_neon_vmax_v((int8x8_t)__p0, (int8x8_t)__p1, 10);
56447__ai poly16x4_t vreinterpret_p16_u64(uint64x1_t __p0) {
56448 poly16x4_t __ret;
56449 __ret = (poly16x4_t)(__p0);
5476756450 return __ret;
5476856451}
54769#ifdef __LITTLE_ENDIAN__
54770__ai float64_t vmaxnmvq_f64(float64x2_t __p0) {
54771 float64_t __ret;
54772 __ret = (float64_t) __builtin_neon_vmaxnmvq_f64(__p0);
56452__ai poly16x4_t vreinterpret_p16_u16(uint16x4_t __p0) {
56453 poly16x4_t __ret;
56454 __ret = (poly16x4_t)(__p0);
5477356455 return __ret;
5477456456}
54775#else
54776__ai float64_t vmaxnmvq_f64(float64x2_t __p0) {
54777 float64_t __ret;
54778 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
54779 __ret = (float64_t) __builtin_neon_vmaxnmvq_f64(__rev0);
56457__ai poly16x4_t vreinterpret_p16_s8(int8x8_t __p0) {
56458 poly16x4_t __ret;
56459 __ret = (poly16x4_t)(__p0);
5478056460 return __ret;
5478156461}
54782#endif
54783
54784#ifdef __LITTLE_ENDIAN__
54785__ai float32_t vmaxnmvq_f32(float32x4_t __p0) {
54786 float32_t __ret;
54787 __ret = (float32_t) __builtin_neon_vmaxnmvq_f32(__p0);
56462__ai poly16x4_t vreinterpret_p16_f64(float64x1_t __p0) {
56463 poly16x4_t __ret;
56464 __ret = (poly16x4_t)(__p0);
5478856465 return __ret;
5478956466}
54790#else
54791__ai float32_t vmaxnmvq_f32(float32x4_t __p0) {
54792 float32_t __ret;
54793 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
54794 __ret = (float32_t) __builtin_neon_vmaxnmvq_f32(__rev0);
56467__ai poly16x4_t vreinterpret_p16_f32(float32x2_t __p0) {
56468 poly16x4_t __ret;
56469 __ret = (poly16x4_t)(__p0);
5479556470 return __ret;
5479656471}
54797#endif
54798
54799#ifdef __LITTLE_ENDIAN__
54800__ai float32_t vmaxnmv_f32(float32x2_t __p0) {
54801 float32_t __ret;
54802 __ret = (float32_t) __builtin_neon_vmaxnmv_f32(__p0);
56472__ai poly16x4_t vreinterpret_p16_f16(float16x4_t __p0) {
56473 poly16x4_t __ret;
56474 __ret = (poly16x4_t)(__p0);
5480356475 return __ret;
5480456476}
54805#else
54806__ai float32_t vmaxnmv_f32(float32x2_t __p0) {
54807 float32_t __ret;
54808 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
54809 __ret = (float32_t) __builtin_neon_vmaxnmv_f32(__rev0);
56477__ai poly16x4_t vreinterpret_p16_s32(int32x2_t __p0) {
56478 poly16x4_t __ret;
56479 __ret = (poly16x4_t)(__p0);
5481056480 return __ret;
5481156481}
54812#endif
54813
54814#ifdef __LITTLE_ENDIAN__
54815__ai uint8_t vmaxvq_u8(uint8x16_t __p0) {
54816 uint8_t __ret;
54817 __ret = (uint8_t) __builtin_neon_vmaxvq_u8(__p0);
56482__ai poly16x4_t vreinterpret_p16_s64(int64x1_t __p0) {
56483 poly16x4_t __ret;
56484 __ret = (poly16x4_t)(__p0);
5481856485 return __ret;
5481956486}
54820#else
54821__ai uint8_t vmaxvq_u8(uint8x16_t __p0) {
54822 uint8_t __ret;
54823 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
54824 __ret = (uint8_t) __builtin_neon_vmaxvq_u8(__rev0);
56487__ai poly16x4_t vreinterpret_p16_s16(int16x4_t __p0) {
56488 poly16x4_t __ret;
56489 __ret = (poly16x4_t)(__p0);
5482556490 return __ret;
5482656491}
54827#endif
54828
54829#ifdef __LITTLE_ENDIAN__
54830__ai uint32_t vmaxvq_u32(uint32x4_t __p0) {
54831 uint32_t __ret;
54832 __ret = (uint32_t) __builtin_neon_vmaxvq_u32(__p0);
56492__ai poly8x16_t vreinterpretq_p8_p128(poly128_t __p0) {
56493 poly8x16_t __ret;
56494 __ret = (poly8x16_t)(__p0);
56495 return __ret;
56496}
56497__ai poly8x16_t vreinterpretq_p8_p64(poly64x2_t __p0) {
56498 poly8x16_t __ret;
56499 __ret = (poly8x16_t)(__p0);
56500 return __ret;
56501}
56502__ai poly8x16_t vreinterpretq_p8_p16(poly16x8_t __p0) {
56503 poly8x16_t __ret;
56504 __ret = (poly8x16_t)(__p0);
56505 return __ret;
56506}
56507__ai poly8x16_t vreinterpretq_p8_u8(uint8x16_t __p0) {
56508 poly8x16_t __ret;
56509 __ret = (poly8x16_t)(__p0);
56510 return __ret;
56511}
56512__ai poly8x16_t vreinterpretq_p8_u32(uint32x4_t __p0) {
56513 poly8x16_t __ret;
56514 __ret = (poly8x16_t)(__p0);
56515 return __ret;
56516}
56517__ai poly8x16_t vreinterpretq_p8_u64(uint64x2_t __p0) {
56518 poly8x16_t __ret;
56519 __ret = (poly8x16_t)(__p0);
56520 return __ret;
56521}
56522__ai poly8x16_t vreinterpretq_p8_u16(uint16x8_t __p0) {
56523 poly8x16_t __ret;
56524 __ret = (poly8x16_t)(__p0);
56525 return __ret;
56526}
56527__ai poly8x16_t vreinterpretq_p8_s8(int8x16_t __p0) {
56528 poly8x16_t __ret;
56529 __ret = (poly8x16_t)(__p0);
56530 return __ret;
56531}
56532__ai poly8x16_t vreinterpretq_p8_f64(float64x2_t __p0) {
56533 poly8x16_t __ret;
56534 __ret = (poly8x16_t)(__p0);
56535 return __ret;
56536}
56537__ai poly8x16_t vreinterpretq_p8_f32(float32x4_t __p0) {
56538 poly8x16_t __ret;
56539 __ret = (poly8x16_t)(__p0);
56540 return __ret;
56541}
56542__ai poly8x16_t vreinterpretq_p8_f16(float16x8_t __p0) {
56543 poly8x16_t __ret;
56544 __ret = (poly8x16_t)(__p0);
56545 return __ret;
56546}
56547__ai poly8x16_t vreinterpretq_p8_s32(int32x4_t __p0) {
56548 poly8x16_t __ret;
56549 __ret = (poly8x16_t)(__p0);
56550 return __ret;
56551}
56552__ai poly8x16_t vreinterpretq_p8_s64(int64x2_t __p0) {
56553 poly8x16_t __ret;
56554 __ret = (poly8x16_t)(__p0);
56555 return __ret;
56556}
56557__ai poly8x16_t vreinterpretq_p8_s16(int16x8_t __p0) {
56558 poly8x16_t __ret;
56559 __ret = (poly8x16_t)(__p0);
56560 return __ret;
56561}
56562__ai poly128_t vreinterpretq_p128_p8(poly8x16_t __p0) {
56563 poly128_t __ret;
56564 __ret = (poly128_t)(__p0);
56565 return __ret;
56566}
56567__ai poly128_t vreinterpretq_p128_p64(poly64x2_t __p0) {
56568 poly128_t __ret;
56569 __ret = (poly128_t)(__p0);
56570 return __ret;
56571}
56572__ai poly128_t vreinterpretq_p128_p16(poly16x8_t __p0) {
56573 poly128_t __ret;
56574 __ret = (poly128_t)(__p0);
56575 return __ret;
56576}
56577__ai poly128_t vreinterpretq_p128_u8(uint8x16_t __p0) {
56578 poly128_t __ret;
56579 __ret = (poly128_t)(__p0);
56580 return __ret;
56581}
56582__ai poly128_t vreinterpretq_p128_u32(uint32x4_t __p0) {
56583 poly128_t __ret;
56584 __ret = (poly128_t)(__p0);
56585 return __ret;
56586}
56587__ai poly128_t vreinterpretq_p128_u64(uint64x2_t __p0) {
56588 poly128_t __ret;
56589 __ret = (poly128_t)(__p0);
56590 return __ret;
56591}
56592__ai poly128_t vreinterpretq_p128_u16(uint16x8_t __p0) {
56593 poly128_t __ret;
56594 __ret = (poly128_t)(__p0);
56595 return __ret;
56596}
56597__ai poly128_t vreinterpretq_p128_s8(int8x16_t __p0) {
56598 poly128_t __ret;
56599 __ret = (poly128_t)(__p0);
56600 return __ret;
56601}
56602__ai poly128_t vreinterpretq_p128_f64(float64x2_t __p0) {
56603 poly128_t __ret;
56604 __ret = (poly128_t)(__p0);
56605 return __ret;
56606}
56607__ai poly128_t vreinterpretq_p128_f32(float32x4_t __p0) {
56608 poly128_t __ret;
56609 __ret = (poly128_t)(__p0);
56610 return __ret;
56611}
56612__ai poly128_t vreinterpretq_p128_f16(float16x8_t __p0) {
56613 poly128_t __ret;
56614 __ret = (poly128_t)(__p0);
56615 return __ret;
56616}
56617__ai poly128_t vreinterpretq_p128_s32(int32x4_t __p0) {
56618 poly128_t __ret;
56619 __ret = (poly128_t)(__p0);
56620 return __ret;
56621}
56622__ai poly128_t vreinterpretq_p128_s64(int64x2_t __p0) {
56623 poly128_t __ret;
56624 __ret = (poly128_t)(__p0);
56625 return __ret;
56626}
56627__ai poly128_t vreinterpretq_p128_s16(int16x8_t __p0) {
56628 poly128_t __ret;
56629 __ret = (poly128_t)(__p0);
56630 return __ret;
56631}
56632__ai poly64x2_t vreinterpretq_p64_p8(poly8x16_t __p0) {
56633 poly64x2_t __ret;
56634 __ret = (poly64x2_t)(__p0);
56635 return __ret;
56636}
56637__ai poly64x2_t vreinterpretq_p64_p128(poly128_t __p0) {
56638 poly64x2_t __ret;
56639 __ret = (poly64x2_t)(__p0);
56640 return __ret;
56641}
56642__ai poly64x2_t vreinterpretq_p64_p16(poly16x8_t __p0) {
56643 poly64x2_t __ret;
56644 __ret = (poly64x2_t)(__p0);
56645 return __ret;
56646}
56647__ai poly64x2_t vreinterpretq_p64_u8(uint8x16_t __p0) {
56648 poly64x2_t __ret;
56649 __ret = (poly64x2_t)(__p0);
56650 return __ret;
56651}
56652__ai poly64x2_t vreinterpretq_p64_u32(uint32x4_t __p0) {
56653 poly64x2_t __ret;
56654 __ret = (poly64x2_t)(__p0);
56655 return __ret;
56656}
56657__ai poly64x2_t vreinterpretq_p64_u64(uint64x2_t __p0) {
56658 poly64x2_t __ret;
56659 __ret = (poly64x2_t)(__p0);
56660 return __ret;
56661}
56662__ai poly64x2_t vreinterpretq_p64_u16(uint16x8_t __p0) {
56663 poly64x2_t __ret;
56664 __ret = (poly64x2_t)(__p0);
56665 return __ret;
56666}
56667__ai poly64x2_t vreinterpretq_p64_s8(int8x16_t __p0) {
56668 poly64x2_t __ret;
56669 __ret = (poly64x2_t)(__p0);
56670 return __ret;
56671}
56672__ai poly64x2_t vreinterpretq_p64_f64(float64x2_t __p0) {
56673 poly64x2_t __ret;
56674 __ret = (poly64x2_t)(__p0);
56675 return __ret;
56676}
56677__ai poly64x2_t vreinterpretq_p64_f32(float32x4_t __p0) {
56678 poly64x2_t __ret;
56679 __ret = (poly64x2_t)(__p0);
56680 return __ret;
56681}
56682__ai poly64x2_t vreinterpretq_p64_f16(float16x8_t __p0) {
56683 poly64x2_t __ret;
56684 __ret = (poly64x2_t)(__p0);
56685 return __ret;
56686}
56687__ai poly64x2_t vreinterpretq_p64_s32(int32x4_t __p0) {
56688 poly64x2_t __ret;
56689 __ret = (poly64x2_t)(__p0);
56690 return __ret;
56691}
56692__ai poly64x2_t vreinterpretq_p64_s64(int64x2_t __p0) {
56693 poly64x2_t __ret;
56694 __ret = (poly64x2_t)(__p0);
56695 return __ret;
56696}
56697__ai poly64x2_t vreinterpretq_p64_s16(int16x8_t __p0) {
56698 poly64x2_t __ret;
56699 __ret = (poly64x2_t)(__p0);
56700 return __ret;
56701}
56702__ai poly16x8_t vreinterpretq_p16_p8(poly8x16_t __p0) {
56703 poly16x8_t __ret;
56704 __ret = (poly16x8_t)(__p0);
56705 return __ret;
56706}
56707__ai poly16x8_t vreinterpretq_p16_p128(poly128_t __p0) {
56708 poly16x8_t __ret;
56709 __ret = (poly16x8_t)(__p0);
56710 return __ret;
56711}
56712__ai poly16x8_t vreinterpretq_p16_p64(poly64x2_t __p0) {
56713 poly16x8_t __ret;
56714 __ret = (poly16x8_t)(__p0);
56715 return __ret;
56716}
56717__ai poly16x8_t vreinterpretq_p16_u8(uint8x16_t __p0) {
56718 poly16x8_t __ret;
56719 __ret = (poly16x8_t)(__p0);
56720 return __ret;
56721}
56722__ai poly16x8_t vreinterpretq_p16_u32(uint32x4_t __p0) {
56723 poly16x8_t __ret;
56724 __ret = (poly16x8_t)(__p0);
56725 return __ret;
56726}
56727__ai poly16x8_t vreinterpretq_p16_u64(uint64x2_t __p0) {
56728 poly16x8_t __ret;
56729 __ret = (poly16x8_t)(__p0);
56730 return __ret;
56731}
56732__ai poly16x8_t vreinterpretq_p16_u16(uint16x8_t __p0) {
56733 poly16x8_t __ret;
56734 __ret = (poly16x8_t)(__p0);
56735 return __ret;
56736}
56737__ai poly16x8_t vreinterpretq_p16_s8(int8x16_t __p0) {
56738 poly16x8_t __ret;
56739 __ret = (poly16x8_t)(__p0);
56740 return __ret;
56741}
56742__ai poly16x8_t vreinterpretq_p16_f64(float64x2_t __p0) {
56743 poly16x8_t __ret;
56744 __ret = (poly16x8_t)(__p0);
56745 return __ret;
56746}
56747__ai poly16x8_t vreinterpretq_p16_f32(float32x4_t __p0) {
56748 poly16x8_t __ret;
56749 __ret = (poly16x8_t)(__p0);
56750 return __ret;
56751}
56752__ai poly16x8_t vreinterpretq_p16_f16(float16x8_t __p0) {
56753 poly16x8_t __ret;
56754 __ret = (poly16x8_t)(__p0);
56755 return __ret;
56756}
56757__ai poly16x8_t vreinterpretq_p16_s32(int32x4_t __p0) {
56758 poly16x8_t __ret;
56759 __ret = (poly16x8_t)(__p0);
56760 return __ret;
56761}
56762__ai poly16x8_t vreinterpretq_p16_s64(int64x2_t __p0) {
56763 poly16x8_t __ret;
56764 __ret = (poly16x8_t)(__p0);
56765 return __ret;
56766}
56767__ai poly16x8_t vreinterpretq_p16_s16(int16x8_t __p0) {
56768 poly16x8_t __ret;
56769 __ret = (poly16x8_t)(__p0);
56770 return __ret;
56771}
56772__ai uint8x16_t vreinterpretq_u8_p8(poly8x16_t __p0) {
56773 uint8x16_t __ret;
56774 __ret = (uint8x16_t)(__p0);
56775 return __ret;
56776}
56777__ai uint8x16_t vreinterpretq_u8_p128(poly128_t __p0) {
56778 uint8x16_t __ret;
56779 __ret = (uint8x16_t)(__p0);
56780 return __ret;
56781}
56782__ai uint8x16_t vreinterpretq_u8_p64(poly64x2_t __p0) {
56783 uint8x16_t __ret;
56784 __ret = (uint8x16_t)(__p0);
56785 return __ret;
56786}
56787__ai uint8x16_t vreinterpretq_u8_p16(poly16x8_t __p0) {
56788 uint8x16_t __ret;
56789 __ret = (uint8x16_t)(__p0);
56790 return __ret;
56791}
56792__ai uint8x16_t vreinterpretq_u8_u32(uint32x4_t __p0) {
56793 uint8x16_t __ret;
56794 __ret = (uint8x16_t)(__p0);
56795 return __ret;
56796}
56797__ai uint8x16_t vreinterpretq_u8_u64(uint64x2_t __p0) {
56798 uint8x16_t __ret;
56799 __ret = (uint8x16_t)(__p0);
56800 return __ret;
56801}
56802__ai uint8x16_t vreinterpretq_u8_u16(uint16x8_t __p0) {
56803 uint8x16_t __ret;
56804 __ret = (uint8x16_t)(__p0);
56805 return __ret;
56806}
56807__ai uint8x16_t vreinterpretq_u8_s8(int8x16_t __p0) {
56808 uint8x16_t __ret;
56809 __ret = (uint8x16_t)(__p0);
56810 return __ret;
56811}
56812__ai uint8x16_t vreinterpretq_u8_f64(float64x2_t __p0) {
56813 uint8x16_t __ret;
56814 __ret = (uint8x16_t)(__p0);
56815 return __ret;
56816}
56817__ai uint8x16_t vreinterpretq_u8_f32(float32x4_t __p0) {
56818 uint8x16_t __ret;
56819 __ret = (uint8x16_t)(__p0);
56820 return __ret;
56821}
56822__ai uint8x16_t vreinterpretq_u8_f16(float16x8_t __p0) {
56823 uint8x16_t __ret;
56824 __ret = (uint8x16_t)(__p0);
56825 return __ret;
56826}
56827__ai uint8x16_t vreinterpretq_u8_s32(int32x4_t __p0) {
56828 uint8x16_t __ret;
56829 __ret = (uint8x16_t)(__p0);
56830 return __ret;
56831}
56832__ai uint8x16_t vreinterpretq_u8_s64(int64x2_t __p0) {
56833 uint8x16_t __ret;
56834 __ret = (uint8x16_t)(__p0);
56835 return __ret;
56836}
56837__ai uint8x16_t vreinterpretq_u8_s16(int16x8_t __p0) {
56838 uint8x16_t __ret;
56839 __ret = (uint8x16_t)(__p0);
56840 return __ret;
56841}
56842__ai uint32x4_t vreinterpretq_u32_p8(poly8x16_t __p0) {
56843 uint32x4_t __ret;
56844 __ret = (uint32x4_t)(__p0);
56845 return __ret;
56846}
56847__ai uint32x4_t vreinterpretq_u32_p128(poly128_t __p0) {
56848 uint32x4_t __ret;
56849 __ret = (uint32x4_t)(__p0);
56850 return __ret;
56851}
56852__ai uint32x4_t vreinterpretq_u32_p64(poly64x2_t __p0) {
56853 uint32x4_t __ret;
56854 __ret = (uint32x4_t)(__p0);
56855 return __ret;
56856}
56857__ai uint32x4_t vreinterpretq_u32_p16(poly16x8_t __p0) {
56858 uint32x4_t __ret;
56859 __ret = (uint32x4_t)(__p0);
56860 return __ret;
56861}
56862__ai uint32x4_t vreinterpretq_u32_u8(uint8x16_t __p0) {
56863 uint32x4_t __ret;
56864 __ret = (uint32x4_t)(__p0);
56865 return __ret;
56866}
56867__ai uint32x4_t vreinterpretq_u32_u64(uint64x2_t __p0) {
56868 uint32x4_t __ret;
56869 __ret = (uint32x4_t)(__p0);
56870 return __ret;
56871}
56872__ai uint32x4_t vreinterpretq_u32_u16(uint16x8_t __p0) {
56873 uint32x4_t __ret;
56874 __ret = (uint32x4_t)(__p0);
56875 return __ret;
56876}
56877__ai uint32x4_t vreinterpretq_u32_s8(int8x16_t __p0) {
56878 uint32x4_t __ret;
56879 __ret = (uint32x4_t)(__p0);
56880 return __ret;
56881}
56882__ai uint32x4_t vreinterpretq_u32_f64(float64x2_t __p0) {
56883 uint32x4_t __ret;
56884 __ret = (uint32x4_t)(__p0);
56885 return __ret;
56886}
56887__ai uint32x4_t vreinterpretq_u32_f32(float32x4_t __p0) {
56888 uint32x4_t __ret;
56889 __ret = (uint32x4_t)(__p0);
56890 return __ret;
56891}
56892__ai uint32x4_t vreinterpretq_u32_f16(float16x8_t __p0) {
56893 uint32x4_t __ret;
56894 __ret = (uint32x4_t)(__p0);
56895 return __ret;
56896}
56897__ai uint32x4_t vreinterpretq_u32_s32(int32x4_t __p0) {
56898 uint32x4_t __ret;
56899 __ret = (uint32x4_t)(__p0);
56900 return __ret;
56901}
56902__ai uint32x4_t vreinterpretq_u32_s64(int64x2_t __p0) {
56903 uint32x4_t __ret;
56904 __ret = (uint32x4_t)(__p0);
56905 return __ret;
56906}
56907__ai uint32x4_t vreinterpretq_u32_s16(int16x8_t __p0) {
56908 uint32x4_t __ret;
56909 __ret = (uint32x4_t)(__p0);
56910 return __ret;
56911}
56912__ai uint64x2_t vreinterpretq_u64_p8(poly8x16_t __p0) {
56913 uint64x2_t __ret;
56914 __ret = (uint64x2_t)(__p0);
5483356915 return __ret;
5483456916}
54835#else
54836__ai uint32_t vmaxvq_u32(uint32x4_t __p0) {
54837 uint32_t __ret;
54838 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
54839 __ret = (uint32_t) __builtin_neon_vmaxvq_u32(__rev0);
56917__ai uint64x2_t vreinterpretq_u64_p128(poly128_t __p0) {
56918 uint64x2_t __ret;
56919 __ret = (uint64x2_t)(__p0);
5484056920 return __ret;
5484156921}
54842#endif
54843
54844#ifdef __LITTLE_ENDIAN__
54845__ai uint16_t vmaxvq_u16(uint16x8_t __p0) {
54846 uint16_t __ret;
54847 __ret = (uint16_t) __builtin_neon_vmaxvq_u16(__p0);
56922__ai uint64x2_t vreinterpretq_u64_p64(poly64x2_t __p0) {
56923 uint64x2_t __ret;
56924 __ret = (uint64x2_t)(__p0);
5484856925 return __ret;
5484956926}
54850#else
54851__ai uint16_t vmaxvq_u16(uint16x8_t __p0) {
54852 uint16_t __ret;
54853 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
54854 __ret = (uint16_t) __builtin_neon_vmaxvq_u16(__rev0);
56927__ai uint64x2_t vreinterpretq_u64_p16(poly16x8_t __p0) {
56928 uint64x2_t __ret;
56929 __ret = (uint64x2_t)(__p0);
5485556930 return __ret;
5485656931}
54857#endif
54858
54859#ifdef __LITTLE_ENDIAN__
54860__ai int8_t vmaxvq_s8(int8x16_t __p0) {
54861 int8_t __ret;
54862 __ret = (int8_t) __builtin_neon_vmaxvq_s8(__p0);
56932__ai uint64x2_t vreinterpretq_u64_u8(uint8x16_t __p0) {
56933 uint64x2_t __ret;
56934 __ret = (uint64x2_t)(__p0);
5486356935 return __ret;
5486456936}
54865#else
54866__ai int8_t vmaxvq_s8(int8x16_t __p0) {
54867 int8_t __ret;
54868 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
54869 __ret = (int8_t) __builtin_neon_vmaxvq_s8(__rev0);
56937__ai uint64x2_t vreinterpretq_u64_u32(uint32x4_t __p0) {
56938 uint64x2_t __ret;
56939 __ret = (uint64x2_t)(__p0);
5487056940 return __ret;
5487156941}
54872#endif
54873
54874#ifdef __LITTLE_ENDIAN__
54875__ai float64_t vmaxvq_f64(float64x2_t __p0) {
54876 float64_t __ret;
54877 __ret = (float64_t) __builtin_neon_vmaxvq_f64(__p0);
56942__ai uint64x2_t vreinterpretq_u64_u16(uint16x8_t __p0) {
56943 uint64x2_t __ret;
56944 __ret = (uint64x2_t)(__p0);
5487856945 return __ret;
5487956946}
54880#else
54881__ai float64_t vmaxvq_f64(float64x2_t __p0) {
54882 float64_t __ret;
54883 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
54884 __ret = (float64_t) __builtin_neon_vmaxvq_f64(__rev0);
56947__ai uint64x2_t vreinterpretq_u64_s8(int8x16_t __p0) {
56948 uint64x2_t __ret;
56949 __ret = (uint64x2_t)(__p0);
5488556950 return __ret;
5488656951}
54887#endif
54888
54889#ifdef __LITTLE_ENDIAN__
54890__ai float32_t vmaxvq_f32(float32x4_t __p0) {
54891 float32_t __ret;
54892 __ret = (float32_t) __builtin_neon_vmaxvq_f32(__p0);
56952__ai uint64x2_t vreinterpretq_u64_f64(float64x2_t __p0) {
56953 uint64x2_t __ret;
56954 __ret = (uint64x2_t)(__p0);
5489356955 return __ret;
5489456956}
54895#else
54896__ai float32_t vmaxvq_f32(float32x4_t __p0) {
54897 float32_t __ret;
54898 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
54899 __ret = (float32_t) __builtin_neon_vmaxvq_f32(__rev0);
56957__ai uint64x2_t vreinterpretq_u64_f32(float32x4_t __p0) {
56958 uint64x2_t __ret;
56959 __ret = (uint64x2_t)(__p0);
5490056960 return __ret;
5490156961}
54902#endif
54903
54904#ifdef __LITTLE_ENDIAN__
54905__ai int32_t vmaxvq_s32(int32x4_t __p0) {
54906 int32_t __ret;
54907 __ret = (int32_t) __builtin_neon_vmaxvq_s32(__p0);
56962__ai uint64x2_t vreinterpretq_u64_f16(float16x8_t __p0) {
56963 uint64x2_t __ret;
56964 __ret = (uint64x2_t)(__p0);
5490856965 return __ret;
5490956966}
54910#else
54911__ai int32_t vmaxvq_s32(int32x4_t __p0) {
54912 int32_t __ret;
54913 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
54914 __ret = (int32_t) __builtin_neon_vmaxvq_s32(__rev0);
56967__ai uint64x2_t vreinterpretq_u64_s32(int32x4_t __p0) {
56968 uint64x2_t __ret;
56969 __ret = (uint64x2_t)(__p0);
5491556970 return __ret;
5491656971}
54917#endif
54918
54919#ifdef __LITTLE_ENDIAN__
54920__ai int16_t vmaxvq_s16(int16x8_t __p0) {
54921 int16_t __ret;
54922 __ret = (int16_t) __builtin_neon_vmaxvq_s16(__p0);
56972__ai uint64x2_t vreinterpretq_u64_s64(int64x2_t __p0) {
56973 uint64x2_t __ret;
56974 __ret = (uint64x2_t)(__p0);
5492356975 return __ret;
5492456976}
54925#else
54926__ai int16_t vmaxvq_s16(int16x8_t __p0) {
54927 int16_t __ret;
54928 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
54929 __ret = (int16_t) __builtin_neon_vmaxvq_s16(__rev0);
56977__ai uint64x2_t vreinterpretq_u64_s16(int16x8_t __p0) {
56978 uint64x2_t __ret;
56979 __ret = (uint64x2_t)(__p0);
5493056980 return __ret;
5493156981}
54932#endif
54933
54934#ifdef __LITTLE_ENDIAN__
54935__ai uint8_t vmaxv_u8(uint8x8_t __p0) {
54936 uint8_t __ret;
54937 __ret = (uint8_t) __builtin_neon_vmaxv_u8(__p0);
56982__ai uint16x8_t vreinterpretq_u16_p8(poly8x16_t __p0) {
56983 uint16x8_t __ret;
56984 __ret = (uint16x8_t)(__p0);
5493856985 return __ret;
5493956986}
54940#else
54941__ai uint8_t vmaxv_u8(uint8x8_t __p0) {
54942 uint8_t __ret;
54943 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
54944 __ret = (uint8_t) __builtin_neon_vmaxv_u8(__rev0);
56987__ai uint16x8_t vreinterpretq_u16_p128(poly128_t __p0) {
56988 uint16x8_t __ret;
56989 __ret = (uint16x8_t)(__p0);
5494556990 return __ret;
5494656991}
54947#endif
54948
54949#ifdef __LITTLE_ENDIAN__
54950__ai uint32_t vmaxv_u32(uint32x2_t __p0) {
54951 uint32_t __ret;
54952 __ret = (uint32_t) __builtin_neon_vmaxv_u32(__p0);
56992__ai uint16x8_t vreinterpretq_u16_p64(poly64x2_t __p0) {
56993 uint16x8_t __ret;
56994 __ret = (uint16x8_t)(__p0);
5495356995 return __ret;
5495456996}
54955#else
54956__ai uint32_t vmaxv_u32(uint32x2_t __p0) {
54957 uint32_t __ret;
54958 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
54959 __ret = (uint32_t) __builtin_neon_vmaxv_u32(__rev0);
56997__ai uint16x8_t vreinterpretq_u16_p16(poly16x8_t __p0) {
56998 uint16x8_t __ret;
56999 __ret = (uint16x8_t)(__p0);
5496057000 return __ret;
5496157001}
54962#endif
54963
54964#ifdef __LITTLE_ENDIAN__
54965__ai uint16_t vmaxv_u16(uint16x4_t __p0) {
54966 uint16_t __ret;
54967 __ret = (uint16_t) __builtin_neon_vmaxv_u16(__p0);
57002__ai uint16x8_t vreinterpretq_u16_u8(uint8x16_t __p0) {
57003 uint16x8_t __ret;
57004 __ret = (uint16x8_t)(__p0);
5496857005 return __ret;
5496957006}
54970#else
54971__ai uint16_t vmaxv_u16(uint16x4_t __p0) {
54972 uint16_t __ret;
54973 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
54974 __ret = (uint16_t) __builtin_neon_vmaxv_u16(__rev0);
57007__ai uint16x8_t vreinterpretq_u16_u32(uint32x4_t __p0) {
57008 uint16x8_t __ret;
57009 __ret = (uint16x8_t)(__p0);
5497557010 return __ret;
5497657011}
54977#endif
54978
54979#ifdef __LITTLE_ENDIAN__
54980__ai int8_t vmaxv_s8(int8x8_t __p0) {
54981 int8_t __ret;
54982 __ret = (int8_t) __builtin_neon_vmaxv_s8(__p0);
57012__ai uint16x8_t vreinterpretq_u16_u64(uint64x2_t __p0) {
57013 uint16x8_t __ret;
57014 __ret = (uint16x8_t)(__p0);
5498357015 return __ret;
5498457016}
54985#else
54986__ai int8_t vmaxv_s8(int8x8_t __p0) {
54987 int8_t __ret;
54988 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
54989 __ret = (int8_t) __builtin_neon_vmaxv_s8(__rev0);
57017__ai uint16x8_t vreinterpretq_u16_s8(int8x16_t __p0) {
57018 uint16x8_t __ret;
57019 __ret = (uint16x8_t)(__p0);
5499057020 return __ret;
5499157021}
54992#endif
54993
54994#ifdef __LITTLE_ENDIAN__
54995__ai float32_t vmaxv_f32(float32x2_t __p0) {
54996 float32_t __ret;
54997 __ret = (float32_t) __builtin_neon_vmaxv_f32(__p0);
57022__ai uint16x8_t vreinterpretq_u16_f64(float64x2_t __p0) {
57023 uint16x8_t __ret;
57024 __ret = (uint16x8_t)(__p0);
5499857025 return __ret;
5499957026}
55000#else
55001__ai float32_t vmaxv_f32(float32x2_t __p0) {
55002 float32_t __ret;
55003 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
55004 __ret = (float32_t) __builtin_neon_vmaxv_f32(__rev0);
57027__ai uint16x8_t vreinterpretq_u16_f32(float32x4_t __p0) {
57028 uint16x8_t __ret;
57029 __ret = (uint16x8_t)(__p0);
5500557030 return __ret;
5500657031}
55007#endif
55008
55009#ifdef __LITTLE_ENDIAN__
55010__ai int32_t vmaxv_s32(int32x2_t __p0) {
55011 int32_t __ret;
55012 __ret = (int32_t) __builtin_neon_vmaxv_s32(__p0);
57032__ai uint16x8_t vreinterpretq_u16_f16(float16x8_t __p0) {
57033 uint16x8_t __ret;
57034 __ret = (uint16x8_t)(__p0);
5501357035 return __ret;
5501457036}
55015#else
55016__ai int32_t vmaxv_s32(int32x2_t __p0) {
55017 int32_t __ret;
55018 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
55019 __ret = (int32_t) __builtin_neon_vmaxv_s32(__rev0);
57037__ai uint16x8_t vreinterpretq_u16_s32(int32x4_t __p0) {
57038 uint16x8_t __ret;
57039 __ret = (uint16x8_t)(__p0);
5502057040 return __ret;
5502157041}
55022#endif
55023
55024#ifdef __LITTLE_ENDIAN__
55025__ai int16_t vmaxv_s16(int16x4_t __p0) {
55026 int16_t __ret;
55027 __ret = (int16_t) __builtin_neon_vmaxv_s16(__p0);
57042__ai uint16x8_t vreinterpretq_u16_s64(int64x2_t __p0) {
57043 uint16x8_t __ret;
57044 __ret = (uint16x8_t)(__p0);
5502857045 return __ret;
5502957046}
55030#else
55031__ai int16_t vmaxv_s16(int16x4_t __p0) {
55032 int16_t __ret;
55033 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
55034 __ret = (int16_t) __builtin_neon_vmaxv_s16(__rev0);
57047__ai uint16x8_t vreinterpretq_u16_s16(int16x8_t __p0) {
57048 uint16x8_t __ret;
57049 __ret = (uint16x8_t)(__p0);
5503557050 return __ret;
5503657051}
55037#endif
55038
55039#ifdef __LITTLE_ENDIAN__
55040__ai float64x2_t vminq_f64(float64x2_t __p0, float64x2_t __p1) {
55041 float64x2_t __ret;
55042 __ret = (float64x2_t) __builtin_neon_vminq_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
57052__ai int8x16_t vreinterpretq_s8_p8(poly8x16_t __p0) {
57053 int8x16_t __ret;
57054 __ret = (int8x16_t)(__p0);
5504357055 return __ret;
5504457056}
55045#else
55046__ai float64x2_t vminq_f64(float64x2_t __p0, float64x2_t __p1) {
55047 float64x2_t __ret;
55048 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
55049 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
55050 __ret = (float64x2_t) __builtin_neon_vminq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
55051 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
57057__ai int8x16_t vreinterpretq_s8_p128(poly128_t __p0) {
57058 int8x16_t __ret;
57059 __ret = (int8x16_t)(__p0);
5505257060 return __ret;
5505357061}
55054#endif
55055
55056__ai float64x1_t vmin_f64(float64x1_t __p0, float64x1_t __p1) {
55057 float64x1_t __ret;
55058 __ret = (float64x1_t) __builtin_neon_vmin_v((int8x8_t)__p0, (int8x8_t)__p1, 10);
57062__ai int8x16_t vreinterpretq_s8_p64(poly64x2_t __p0) {
57063 int8x16_t __ret;
57064 __ret = (int8x16_t)(__p0);
5505957065 return __ret;
5506057066}
55061#ifdef __LITTLE_ENDIAN__
55062__ai float64_t vminnmvq_f64(float64x2_t __p0) {
55063 float64_t __ret;
55064 __ret = (float64_t) __builtin_neon_vminnmvq_f64(__p0);
57067__ai int8x16_t vreinterpretq_s8_p16(poly16x8_t __p0) {
57068 int8x16_t __ret;
57069 __ret = (int8x16_t)(__p0);
5506557070 return __ret;
5506657071}
55067#else
55068__ai float64_t vminnmvq_f64(float64x2_t __p0) {
55069 float64_t __ret;
55070 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
55071 __ret = (float64_t) __builtin_neon_vminnmvq_f64(__rev0);
57072__ai int8x16_t vreinterpretq_s8_u8(uint8x16_t __p0) {
57073 int8x16_t __ret;
57074 __ret = (int8x16_t)(__p0);
5507257075 return __ret;
5507357076}
55074#endif
55075
55076#ifdef __LITTLE_ENDIAN__
55077__ai float32_t vminnmvq_f32(float32x4_t __p0) {
55078 float32_t __ret;
55079 __ret = (float32_t) __builtin_neon_vminnmvq_f32(__p0);
57077__ai int8x16_t vreinterpretq_s8_u32(uint32x4_t __p0) {
57078 int8x16_t __ret;
57079 __ret = (int8x16_t)(__p0);
5508057080 return __ret;
5508157081}
55082#else
55083__ai float32_t vminnmvq_f32(float32x4_t __p0) {
55084 float32_t __ret;
55085 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
55086 __ret = (float32_t) __builtin_neon_vminnmvq_f32(__rev0);
57082__ai int8x16_t vreinterpretq_s8_u64(uint64x2_t __p0) {
57083 int8x16_t __ret;
57084 __ret = (int8x16_t)(__p0);
5508757085 return __ret;
5508857086}
55089#endif
55090
55091#ifdef __LITTLE_ENDIAN__
55092__ai float32_t vminnmv_f32(float32x2_t __p0) {
55093 float32_t __ret;
55094 __ret = (float32_t) __builtin_neon_vminnmv_f32(__p0);
57087__ai int8x16_t vreinterpretq_s8_u16(uint16x8_t __p0) {
57088 int8x16_t __ret;
57089 __ret = (int8x16_t)(__p0);
5509557090 return __ret;
5509657091}
55097#else
55098__ai float32_t vminnmv_f32(float32x2_t __p0) {
55099 float32_t __ret;
55100 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
55101 __ret = (float32_t) __builtin_neon_vminnmv_f32(__rev0);
57092__ai int8x16_t vreinterpretq_s8_f64(float64x2_t __p0) {
57093 int8x16_t __ret;
57094 __ret = (int8x16_t)(__p0);
5510257095 return __ret;
5510357096}
55104#endif
55105
55106#ifdef __LITTLE_ENDIAN__
55107__ai uint8_t vminvq_u8(uint8x16_t __p0) {
55108 uint8_t __ret;
55109 __ret = (uint8_t) __builtin_neon_vminvq_u8(__p0);
57097__ai int8x16_t vreinterpretq_s8_f32(float32x4_t __p0) {
57098 int8x16_t __ret;
57099 __ret = (int8x16_t)(__p0);
5511057100 return __ret;
5511157101}
55112#else
55113__ai uint8_t vminvq_u8(uint8x16_t __p0) {
55114 uint8_t __ret;
55115 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55116 __ret = (uint8_t) __builtin_neon_vminvq_u8(__rev0);
57102__ai int8x16_t vreinterpretq_s8_f16(float16x8_t __p0) {
57103 int8x16_t __ret;
57104 __ret = (int8x16_t)(__p0);
5511757105 return __ret;
5511857106}
55119#endif
55120
55121#ifdef __LITTLE_ENDIAN__
55122__ai uint32_t vminvq_u32(uint32x4_t __p0) {
55123 uint32_t __ret;
55124 __ret = (uint32_t) __builtin_neon_vminvq_u32(__p0);
57107__ai int8x16_t vreinterpretq_s8_s32(int32x4_t __p0) {
57108 int8x16_t __ret;
57109 __ret = (int8x16_t)(__p0);
5512557110 return __ret;
5512657111}
55127#else
55128__ai uint32_t vminvq_u32(uint32x4_t __p0) {
55129 uint32_t __ret;
55130 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
55131 __ret = (uint32_t) __builtin_neon_vminvq_u32(__rev0);
57112__ai int8x16_t vreinterpretq_s8_s64(int64x2_t __p0) {
57113 int8x16_t __ret;
57114 __ret = (int8x16_t)(__p0);
5513257115 return __ret;
5513357116}
55134#endif
55135
55136#ifdef __LITTLE_ENDIAN__
55137__ai uint16_t vminvq_u16(uint16x8_t __p0) {
55138 uint16_t __ret;
55139 __ret = (uint16_t) __builtin_neon_vminvq_u16(__p0);
57117__ai int8x16_t vreinterpretq_s8_s16(int16x8_t __p0) {
57118 int8x16_t __ret;
57119 __ret = (int8x16_t)(__p0);
5514057120 return __ret;
5514157121}
55142#else
55143__ai uint16_t vminvq_u16(uint16x8_t __p0) {
55144 uint16_t __ret;
55145 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
55146 __ret = (uint16_t) __builtin_neon_vminvq_u16(__rev0);
57122__ai float64x2_t vreinterpretq_f64_p8(poly8x16_t __p0) {
57123 float64x2_t __ret;
57124 __ret = (float64x2_t)(__p0);
5514757125 return __ret;
5514857126}
55149#endif
55150
55151#ifdef __LITTLE_ENDIAN__
55152__ai int8_t vminvq_s8(int8x16_t __p0) {
55153 int8_t __ret;
55154 __ret = (int8_t) __builtin_neon_vminvq_s8(__p0);
57127__ai float64x2_t vreinterpretq_f64_p128(poly128_t __p0) {
57128 float64x2_t __ret;
57129 __ret = (float64x2_t)(__p0);
5515557130 return __ret;
5515657131}
55157#else
55158__ai int8_t vminvq_s8(int8x16_t __p0) {
55159 int8_t __ret;
55160 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
55161 __ret = (int8_t) __builtin_neon_vminvq_s8(__rev0);
57132__ai float64x2_t vreinterpretq_f64_p64(poly64x2_t __p0) {
57133 float64x2_t __ret;
57134 __ret = (float64x2_t)(__p0);
5516257135 return __ret;
5516357136}
55164#endif
55165
55166#ifdef __LITTLE_ENDIAN__
55167__ai float64_t vminvq_f64(float64x2_t __p0) {
55168 float64_t __ret;
55169 __ret = (float64_t) __builtin_neon_vminvq_f64(__p0);
57137__ai float64x2_t vreinterpretq_f64_p16(poly16x8_t __p0) {
57138 float64x2_t __ret;
57139 __ret = (float64x2_t)(__p0);
5517057140 return __ret;
5517157141}
55172#else
55173__ai float64_t vminvq_f64(float64x2_t __p0) {
55174 float64_t __ret;
55175 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
55176 __ret = (float64_t) __builtin_neon_vminvq_f64(__rev0);
57142__ai float64x2_t vreinterpretq_f64_u8(uint8x16_t __p0) {
57143 float64x2_t __ret;
57144 __ret = (float64x2_t)(__p0);
5517757145 return __ret;
5517857146}
55179#endif
55180
55181#ifdef __LITTLE_ENDIAN__
55182__ai float32_t vminvq_f32(float32x4_t __p0) {
55183 float32_t __ret;
55184 __ret = (float32_t) __builtin_neon_vminvq_f32(__p0);
57147__ai float64x2_t vreinterpretq_f64_u32(uint32x4_t __p0) {
57148 float64x2_t __ret;
57149 __ret = (float64x2_t)(__p0);
5518557150 return __ret;
5518657151}
55187#else
55188__ai float32_t vminvq_f32(float32x4_t __p0) {
55189 float32_t __ret;
55190 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
55191 __ret = (float32_t) __builtin_neon_vminvq_f32(__rev0);
57152__ai float64x2_t vreinterpretq_f64_u64(uint64x2_t __p0) {
57153 float64x2_t __ret;
57154 __ret = (float64x2_t)(__p0);
5519257155 return __ret;
5519357156}
55194#endif
55195
55196#ifdef __LITTLE_ENDIAN__
55197__ai int32_t vminvq_s32(int32x4_t __p0) {
55198 int32_t __ret;
55199 __ret = (int32_t) __builtin_neon_vminvq_s32(__p0);
57157__ai float64x2_t vreinterpretq_f64_u16(uint16x8_t __p0) {
57158 float64x2_t __ret;
57159 __ret = (float64x2_t)(__p0);
5520057160 return __ret;
5520157161}
55202#else
55203__ai int32_t vminvq_s32(int32x4_t __p0) {
55204 int32_t __ret;
55205 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
55206 __ret = (int32_t) __builtin_neon_vminvq_s32(__rev0);
57162__ai float64x2_t vreinterpretq_f64_s8(int8x16_t __p0) {
57163 float64x2_t __ret;
57164 __ret = (float64x2_t)(__p0);
5520757165 return __ret;
5520857166}
55209#endif
55210
55211#ifdef __LITTLE_ENDIAN__
55212__ai int16_t vminvq_s16(int16x8_t __p0) {
55213 int16_t __ret;
55214 __ret = (int16_t) __builtin_neon_vminvq_s16(__p0);
57167__ai float64x2_t vreinterpretq_f64_f32(float32x4_t __p0) {
57168 float64x2_t __ret;
57169 __ret = (float64x2_t)(__p0);
5521557170 return __ret;
5521657171}
55217#else
55218__ai int16_t vminvq_s16(int16x8_t __p0) {
55219 int16_t __ret;
55220 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
55221 __ret = (int16_t) __builtin_neon_vminvq_s16(__rev0);
57172__ai float64x2_t vreinterpretq_f64_f16(float16x8_t __p0) {
57173 float64x2_t __ret;
57174 __ret = (float64x2_t)(__p0);
5522257175 return __ret;
5522357176}
55224#endif
55225
55226#ifdef __LITTLE_ENDIAN__
55227__ai uint8_t vminv_u8(uint8x8_t __p0) {
55228 uint8_t __ret;
55229 __ret = (uint8_t) __builtin_neon_vminv_u8(__p0);
57177__ai float64x2_t vreinterpretq_f64_s32(int32x4_t __p0) {
57178 float64x2_t __ret;
57179 __ret = (float64x2_t)(__p0);
5523057180 return __ret;
5523157181}
55232#else
55233__ai uint8_t vminv_u8(uint8x8_t __p0) {
55234 uint8_t __ret;
55235 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
55236 __ret = (uint8_t) __builtin_neon_vminv_u8(__rev0);
57182__ai float64x2_t vreinterpretq_f64_s64(int64x2_t __p0) {
57183 float64x2_t __ret;
57184 __ret = (float64x2_t)(__p0);
5523757185 return __ret;
5523857186}
55239#endif
55240
55241#ifdef __LITTLE_ENDIAN__
55242__ai uint32_t vminv_u32(uint32x2_t __p0) {
55243 uint32_t __ret;
55244 __ret = (uint32_t) __builtin_neon_vminv_u32(__p0);
57187__ai float64x2_t vreinterpretq_f64_s16(int16x8_t __p0) {
57188 float64x2_t __ret;
57189 __ret = (float64x2_t)(__p0);
5524557190 return __ret;
5524657191}
55247#else
55248__ai uint32_t vminv_u32(uint32x2_t __p0) {
55249 uint32_t __ret;
55250 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
55251 __ret = (uint32_t) __builtin_neon_vminv_u32(__rev0);
57192__ai float32x4_t vreinterpretq_f32_p8(poly8x16_t __p0) {
57193 float32x4_t __ret;
57194 __ret = (float32x4_t)(__p0);
5525257195 return __ret;
5525357196}
55254#endif
55255
55256#ifdef __LITTLE_ENDIAN__
55257__ai uint16_t vminv_u16(uint16x4_t __p0) {
55258 uint16_t __ret;
55259 __ret = (uint16_t) __builtin_neon_vminv_u16(__p0);
57197__ai float32x4_t vreinterpretq_f32_p128(poly128_t __p0) {
57198 float32x4_t __ret;
57199 __ret = (float32x4_t)(__p0);
5526057200 return __ret;
5526157201}
55262#else
55263__ai uint16_t vminv_u16(uint16x4_t __p0) {
55264 uint16_t __ret;
55265 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
55266 __ret = (uint16_t) __builtin_neon_vminv_u16(__rev0);
57202__ai float32x4_t vreinterpretq_f32_p64(poly64x2_t __p0) {
57203 float32x4_t __ret;
57204 __ret = (float32x4_t)(__p0);
5526757205 return __ret;
5526857206}
55269#endif
55270
55271#ifdef __LITTLE_ENDIAN__
55272__ai int8_t vminv_s8(int8x8_t __p0) {
55273 int8_t __ret;
55274 __ret = (int8_t) __builtin_neon_vminv_s8(__p0);
57207__ai float32x4_t vreinterpretq_f32_p16(poly16x8_t __p0) {
57208 float32x4_t __ret;
57209 __ret = (float32x4_t)(__p0);
5527557210 return __ret;
5527657211}
55277#else
55278__ai int8_t vminv_s8(int8x8_t __p0) {
55279 int8_t __ret;
55280 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
55281 __ret = (int8_t) __builtin_neon_vminv_s8(__rev0);
57212__ai float32x4_t vreinterpretq_f32_u8(uint8x16_t __p0) {
57213 float32x4_t __ret;
57214 __ret = (float32x4_t)(__p0);
57215 return __ret;
57216}
57217__ai float32x4_t vreinterpretq_f32_u32(uint32x4_t __p0) {
57218 float32x4_t __ret;
57219 __ret = (float32x4_t)(__p0);
5528257220 return __ret;
5528357221}
55284#endif
55285
55286#ifdef __LITTLE_ENDIAN__
55287__ai float32_t vminv_f32(float32x2_t __p0) {
55288 float32_t __ret;
55289 __ret = (float32_t) __builtin_neon_vminv_f32(__p0);
57222__ai float32x4_t vreinterpretq_f32_u64(uint64x2_t __p0) {
57223 float32x4_t __ret;
57224 __ret = (float32x4_t)(__p0);
5529057225 return __ret;
5529157226}
55292#else
55293__ai float32_t vminv_f32(float32x2_t __p0) {
55294 float32_t __ret;
55295 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
55296 __ret = (float32_t) __builtin_neon_vminv_f32(__rev0);
57227__ai float32x4_t vreinterpretq_f32_u16(uint16x8_t __p0) {
57228 float32x4_t __ret;
57229 __ret = (float32x4_t)(__p0);
5529757230 return __ret;
5529857231}
55299#endif
55300
55301#ifdef __LITTLE_ENDIAN__
55302__ai int32_t vminv_s32(int32x2_t __p0) {
55303 int32_t __ret;
55304 __ret = (int32_t) __builtin_neon_vminv_s32(__p0);
57232__ai float32x4_t vreinterpretq_f32_s8(int8x16_t __p0) {
57233 float32x4_t __ret;
57234 __ret = (float32x4_t)(__p0);
5530557235 return __ret;
5530657236}
55307#else
55308__ai int32_t vminv_s32(int32x2_t __p0) {
55309 int32_t __ret;
55310 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
55311 __ret = (int32_t) __builtin_neon_vminv_s32(__rev0);
57237__ai float32x4_t vreinterpretq_f32_f64(float64x2_t __p0) {
57238 float32x4_t __ret;
57239 __ret = (float32x4_t)(__p0);
5531257240 return __ret;
5531357241}
55314#endif
55315
55316#ifdef __LITTLE_ENDIAN__
55317__ai int16_t vminv_s16(int16x4_t __p0) {
55318 int16_t __ret;
55319 __ret = (int16_t) __builtin_neon_vminv_s16(__p0);
57242__ai float32x4_t vreinterpretq_f32_f16(float16x8_t __p0) {
57243 float32x4_t __ret;
57244 __ret = (float32x4_t)(__p0);
5532057245 return __ret;
5532157246}
55322#else
55323__ai int16_t vminv_s16(int16x4_t __p0) {
55324 int16_t __ret;
55325 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
55326 __ret = (int16_t) __builtin_neon_vminv_s16(__rev0);
57247__ai float32x4_t vreinterpretq_f32_s32(int32x4_t __p0) {
57248 float32x4_t __ret;
57249 __ret = (float32x4_t)(__p0);
5532757250 return __ret;
5532857251}
55329#endif
55330
55331#ifdef __LITTLE_ENDIAN__
55332__ai float64x2_t vmlaq_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
55333 float64x2_t __ret;
55334 __ret = __p0 + __p1 * __p2;
57252__ai float32x4_t vreinterpretq_f32_s64(int64x2_t __p0) {
57253 float32x4_t __ret;
57254 __ret = (float32x4_t)(__p0);
5533557255 return __ret;
5533657256}
55337#else
55338__ai float64x2_t vmlaq_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
55339 float64x2_t __ret;
55340 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
55341 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
55342 float64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
55343 __ret = __rev0 + __rev1 * __rev2;
55344 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
57257__ai float32x4_t vreinterpretq_f32_s16(int16x8_t __p0) {
57258 float32x4_t __ret;
57259 __ret = (float32x4_t)(__p0);
5534557260 return __ret;
5534657261}
55347#endif
55348
55349__ai float64x1_t vmla_f64(float64x1_t __p0, float64x1_t __p1, float64x1_t __p2) {
55350 float64x1_t __ret;
55351 __ret = __p0 + __p1 * __p2;
57262__ai float16x8_t vreinterpretq_f16_p8(poly8x16_t __p0) {
57263 float16x8_t __ret;
57264 __ret = (float16x8_t)(__p0);
5535257265 return __ret;
5535357266}
55354#ifdef __LITTLE_ENDIAN__
55355#define vmlaq_laneq_u32(__p0_531, __p1_531, __p2_531, __p3_531) __extension__ ({ \
55356 uint32x4_t __ret_531; \
55357 uint32x4_t __s0_531 = __p0_531; \
55358 uint32x4_t __s1_531 = __p1_531; \
55359 uint32x4_t __s2_531 = __p2_531; \
55360 __ret_531 = __s0_531 + __s1_531 * splatq_laneq_u32(__s2_531, __p3_531); \
55361 __ret_531; \
55362})
55363#else
55364#define vmlaq_laneq_u32(__p0_532, __p1_532, __p2_532, __p3_532) __extension__ ({ \
55365 uint32x4_t __ret_532; \
55366 uint32x4_t __s0_532 = __p0_532; \
55367 uint32x4_t __s1_532 = __p1_532; \
55368 uint32x4_t __s2_532 = __p2_532; \
55369 uint32x4_t __rev0_532; __rev0_532 = __builtin_shufflevector(__s0_532, __s0_532, 3, 2, 1, 0); \
55370 uint32x4_t __rev1_532; __rev1_532 = __builtin_shufflevector(__s1_532, __s1_532, 3, 2, 1, 0); \
55371 uint32x4_t __rev2_532; __rev2_532 = __builtin_shufflevector(__s2_532, __s2_532, 3, 2, 1, 0); \
55372 __ret_532 = __rev0_532 + __rev1_532 * __noswap_splatq_laneq_u32(__rev2_532, __p3_532); \
55373 __ret_532 = __builtin_shufflevector(__ret_532, __ret_532, 3, 2, 1, 0); \
55374 __ret_532; \
55375})
55376#endif
55377
55378#ifdef __LITTLE_ENDIAN__
55379#define vmlaq_laneq_u16(__p0_533, __p1_533, __p2_533, __p3_533) __extension__ ({ \
55380 uint16x8_t __ret_533; \
55381 uint16x8_t __s0_533 = __p0_533; \
55382 uint16x8_t __s1_533 = __p1_533; \
55383 uint16x8_t __s2_533 = __p2_533; \
55384 __ret_533 = __s0_533 + __s1_533 * splatq_laneq_u16(__s2_533, __p3_533); \
55385 __ret_533; \
55386})
55387#else
55388#define vmlaq_laneq_u16(__p0_534, __p1_534, __p2_534, __p3_534) __extension__ ({ \
55389 uint16x8_t __ret_534; \
55390 uint16x8_t __s0_534 = __p0_534; \
55391 uint16x8_t __s1_534 = __p1_534; \
55392 uint16x8_t __s2_534 = __p2_534; \
55393 uint16x8_t __rev0_534; __rev0_534 = __builtin_shufflevector(__s0_534, __s0_534, 7, 6, 5, 4, 3, 2, 1, 0); \
55394 uint16x8_t __rev1_534; __rev1_534 = __builtin_shufflevector(__s1_534, __s1_534, 7, 6, 5, 4, 3, 2, 1, 0); \
55395 uint16x8_t __rev2_534; __rev2_534 = __builtin_shufflevector(__s2_534, __s2_534, 7, 6, 5, 4, 3, 2, 1, 0); \
55396 __ret_534 = __rev0_534 + __rev1_534 * __noswap_splatq_laneq_u16(__rev2_534, __p3_534); \
55397 __ret_534 = __builtin_shufflevector(__ret_534, __ret_534, 7, 6, 5, 4, 3, 2, 1, 0); \
55398 __ret_534; \
55399})
55400#endif
55401
55402#ifdef __LITTLE_ENDIAN__
55403#define vmlaq_laneq_f32(__p0_535, __p1_535, __p2_535, __p3_535) __extension__ ({ \
55404 float32x4_t __ret_535; \
55405 float32x4_t __s0_535 = __p0_535; \
55406 float32x4_t __s1_535 = __p1_535; \
55407 float32x4_t __s2_535 = __p2_535; \
55408 __ret_535 = __s0_535 + __s1_535 * splatq_laneq_f32(__s2_535, __p3_535); \
55409 __ret_535; \
55410})
55411#else
55412#define vmlaq_laneq_f32(__p0_536, __p1_536, __p2_536, __p3_536) __extension__ ({ \
55413 float32x4_t __ret_536; \
55414 float32x4_t __s0_536 = __p0_536; \
55415 float32x4_t __s1_536 = __p1_536; \
55416 float32x4_t __s2_536 = __p2_536; \
55417 float32x4_t __rev0_536; __rev0_536 = __builtin_shufflevector(__s0_536, __s0_536, 3, 2, 1, 0); \
55418 float32x4_t __rev1_536; __rev1_536 = __builtin_shufflevector(__s1_536, __s1_536, 3, 2, 1, 0); \
55419 float32x4_t __rev2_536; __rev2_536 = __builtin_shufflevector(__s2_536, __s2_536, 3, 2, 1, 0); \
55420 __ret_536 = __rev0_536 + __rev1_536 * __noswap_splatq_laneq_f32(__rev2_536, __p3_536); \
55421 __ret_536 = __builtin_shufflevector(__ret_536, __ret_536, 3, 2, 1, 0); \
55422 __ret_536; \
55423})
55424#endif
55425
55426#ifdef __LITTLE_ENDIAN__
55427#define vmlaq_laneq_s32(__p0_537, __p1_537, __p2_537, __p3_537) __extension__ ({ \
55428 int32x4_t __ret_537; \
55429 int32x4_t __s0_537 = __p0_537; \
55430 int32x4_t __s1_537 = __p1_537; \
55431 int32x4_t __s2_537 = __p2_537; \
55432 __ret_537 = __s0_537 + __s1_537 * splatq_laneq_s32(__s2_537, __p3_537); \
55433 __ret_537; \
55434})
55435#else
55436#define vmlaq_laneq_s32(__p0_538, __p1_538, __p2_538, __p3_538) __extension__ ({ \
55437 int32x4_t __ret_538; \
55438 int32x4_t __s0_538 = __p0_538; \
55439 int32x4_t __s1_538 = __p1_538; \
55440 int32x4_t __s2_538 = __p2_538; \
55441 int32x4_t __rev0_538; __rev0_538 = __builtin_shufflevector(__s0_538, __s0_538, 3, 2, 1, 0); \
55442 int32x4_t __rev1_538; __rev1_538 = __builtin_shufflevector(__s1_538, __s1_538, 3, 2, 1, 0); \
55443 int32x4_t __rev2_538; __rev2_538 = __builtin_shufflevector(__s2_538, __s2_538, 3, 2, 1, 0); \
55444 __ret_538 = __rev0_538 + __rev1_538 * __noswap_splatq_laneq_s32(__rev2_538, __p3_538); \
55445 __ret_538 = __builtin_shufflevector(__ret_538, __ret_538, 3, 2, 1, 0); \
55446 __ret_538; \
55447})
55448#endif
55449
55450#ifdef __LITTLE_ENDIAN__
55451#define vmlaq_laneq_s16(__p0_539, __p1_539, __p2_539, __p3_539) __extension__ ({ \
55452 int16x8_t __ret_539; \
55453 int16x8_t __s0_539 = __p0_539; \
55454 int16x8_t __s1_539 = __p1_539; \
55455 int16x8_t __s2_539 = __p2_539; \
55456 __ret_539 = __s0_539 + __s1_539 * splatq_laneq_s16(__s2_539, __p3_539); \
55457 __ret_539; \
55458})
55459#else
55460#define vmlaq_laneq_s16(__p0_540, __p1_540, __p2_540, __p3_540) __extension__ ({ \
55461 int16x8_t __ret_540; \
55462 int16x8_t __s0_540 = __p0_540; \
55463 int16x8_t __s1_540 = __p1_540; \
55464 int16x8_t __s2_540 = __p2_540; \
55465 int16x8_t __rev0_540; __rev0_540 = __builtin_shufflevector(__s0_540, __s0_540, 7, 6, 5, 4, 3, 2, 1, 0); \
55466 int16x8_t __rev1_540; __rev1_540 = __builtin_shufflevector(__s1_540, __s1_540, 7, 6, 5, 4, 3, 2, 1, 0); \
55467 int16x8_t __rev2_540; __rev2_540 = __builtin_shufflevector(__s2_540, __s2_540, 7, 6, 5, 4, 3, 2, 1, 0); \
55468 __ret_540 = __rev0_540 + __rev1_540 * __noswap_splatq_laneq_s16(__rev2_540, __p3_540); \
55469 __ret_540 = __builtin_shufflevector(__ret_540, __ret_540, 7, 6, 5, 4, 3, 2, 1, 0); \
55470 __ret_540; \
55471})
55472#endif
55473
55474#ifdef __LITTLE_ENDIAN__
55475#define vmla_laneq_u32(__p0_541, __p1_541, __p2_541, __p3_541) __extension__ ({ \
55476 uint32x2_t __ret_541; \
55477 uint32x2_t __s0_541 = __p0_541; \
55478 uint32x2_t __s1_541 = __p1_541; \
55479 uint32x4_t __s2_541 = __p2_541; \
55480 __ret_541 = __s0_541 + __s1_541 * splat_laneq_u32(__s2_541, __p3_541); \
55481 __ret_541; \
55482})
55483#else
55484#define vmla_laneq_u32(__p0_542, __p1_542, __p2_542, __p3_542) __extension__ ({ \
55485 uint32x2_t __ret_542; \
55486 uint32x2_t __s0_542 = __p0_542; \
55487 uint32x2_t __s1_542 = __p1_542; \
55488 uint32x4_t __s2_542 = __p2_542; \
55489 uint32x2_t __rev0_542; __rev0_542 = __builtin_shufflevector(__s0_542, __s0_542, 1, 0); \
55490 uint32x2_t __rev1_542; __rev1_542 = __builtin_shufflevector(__s1_542, __s1_542, 1, 0); \
55491 uint32x4_t __rev2_542; __rev2_542 = __builtin_shufflevector(__s2_542, __s2_542, 3, 2, 1, 0); \
55492 __ret_542 = __rev0_542 + __rev1_542 * __noswap_splat_laneq_u32(__rev2_542, __p3_542); \
55493 __ret_542 = __builtin_shufflevector(__ret_542, __ret_542, 1, 0); \
55494 __ret_542; \
55495})
55496#endif
55497
55498#ifdef __LITTLE_ENDIAN__
55499#define vmla_laneq_u16(__p0_543, __p1_543, __p2_543, __p3_543) __extension__ ({ \
55500 uint16x4_t __ret_543; \
55501 uint16x4_t __s0_543 = __p0_543; \
55502 uint16x4_t __s1_543 = __p1_543; \
55503 uint16x8_t __s2_543 = __p2_543; \
55504 __ret_543 = __s0_543 + __s1_543 * splat_laneq_u16(__s2_543, __p3_543); \
55505 __ret_543; \
55506})
55507#else
55508#define vmla_laneq_u16(__p0_544, __p1_544, __p2_544, __p3_544) __extension__ ({ \
55509 uint16x4_t __ret_544; \
55510 uint16x4_t __s0_544 = __p0_544; \
55511 uint16x4_t __s1_544 = __p1_544; \
55512 uint16x8_t __s2_544 = __p2_544; \
55513 uint16x4_t __rev0_544; __rev0_544 = __builtin_shufflevector(__s0_544, __s0_544, 3, 2, 1, 0); \
55514 uint16x4_t __rev1_544; __rev1_544 = __builtin_shufflevector(__s1_544, __s1_544, 3, 2, 1, 0); \
55515 uint16x8_t __rev2_544; __rev2_544 = __builtin_shufflevector(__s2_544, __s2_544, 7, 6, 5, 4, 3, 2, 1, 0); \
55516 __ret_544 = __rev0_544 + __rev1_544 * __noswap_splat_laneq_u16(__rev2_544, __p3_544); \
55517 __ret_544 = __builtin_shufflevector(__ret_544, __ret_544, 3, 2, 1, 0); \
55518 __ret_544; \
55519})
55520#endif
55521
55522#ifdef __LITTLE_ENDIAN__
55523#define vmla_laneq_f32(__p0_545, __p1_545, __p2_545, __p3_545) __extension__ ({ \
55524 float32x2_t __ret_545; \
55525 float32x2_t __s0_545 = __p0_545; \
55526 float32x2_t __s1_545 = __p1_545; \
55527 float32x4_t __s2_545 = __p2_545; \
55528 __ret_545 = __s0_545 + __s1_545 * splat_laneq_f32(__s2_545, __p3_545); \
55529 __ret_545; \
55530})
55531#else
55532#define vmla_laneq_f32(__p0_546, __p1_546, __p2_546, __p3_546) __extension__ ({ \
55533 float32x2_t __ret_546; \
55534 float32x2_t __s0_546 = __p0_546; \
55535 float32x2_t __s1_546 = __p1_546; \
55536 float32x4_t __s2_546 = __p2_546; \
55537 float32x2_t __rev0_546; __rev0_546 = __builtin_shufflevector(__s0_546, __s0_546, 1, 0); \
55538 float32x2_t __rev1_546; __rev1_546 = __builtin_shufflevector(__s1_546, __s1_546, 1, 0); \
55539 float32x4_t __rev2_546; __rev2_546 = __builtin_shufflevector(__s2_546, __s2_546, 3, 2, 1, 0); \
55540 __ret_546 = __rev0_546 + __rev1_546 * __noswap_splat_laneq_f32(__rev2_546, __p3_546); \
55541 __ret_546 = __builtin_shufflevector(__ret_546, __ret_546, 1, 0); \
55542 __ret_546; \
55543})
55544#endif
55545
55546#ifdef __LITTLE_ENDIAN__
55547#define vmla_laneq_s32(__p0_547, __p1_547, __p2_547, __p3_547) __extension__ ({ \
55548 int32x2_t __ret_547; \
55549 int32x2_t __s0_547 = __p0_547; \
55550 int32x2_t __s1_547 = __p1_547; \
55551 int32x4_t __s2_547 = __p2_547; \
55552 __ret_547 = __s0_547 + __s1_547 * splat_laneq_s32(__s2_547, __p3_547); \
55553 __ret_547; \
55554})
55555#else
55556#define vmla_laneq_s32(__p0_548, __p1_548, __p2_548, __p3_548) __extension__ ({ \
55557 int32x2_t __ret_548; \
55558 int32x2_t __s0_548 = __p0_548; \
55559 int32x2_t __s1_548 = __p1_548; \
55560 int32x4_t __s2_548 = __p2_548; \
55561 int32x2_t __rev0_548; __rev0_548 = __builtin_shufflevector(__s0_548, __s0_548, 1, 0); \
55562 int32x2_t __rev1_548; __rev1_548 = __builtin_shufflevector(__s1_548, __s1_548, 1, 0); \
55563 int32x4_t __rev2_548; __rev2_548 = __builtin_shufflevector(__s2_548, __s2_548, 3, 2, 1, 0); \
55564 __ret_548 = __rev0_548 + __rev1_548 * __noswap_splat_laneq_s32(__rev2_548, __p3_548); \
55565 __ret_548 = __builtin_shufflevector(__ret_548, __ret_548, 1, 0); \
55566 __ret_548; \
55567})
55568#endif
55569
55570#ifdef __LITTLE_ENDIAN__
55571#define vmla_laneq_s16(__p0_549, __p1_549, __p2_549, __p3_549) __extension__ ({ \
55572 int16x4_t __ret_549; \
55573 int16x4_t __s0_549 = __p0_549; \
55574 int16x4_t __s1_549 = __p1_549; \
55575 int16x8_t __s2_549 = __p2_549; \
55576 __ret_549 = __s0_549 + __s1_549 * splat_laneq_s16(__s2_549, __p3_549); \
55577 __ret_549; \
55578})
55579#else
55580#define vmla_laneq_s16(__p0_550, __p1_550, __p2_550, __p3_550) __extension__ ({ \
55581 int16x4_t __ret_550; \
55582 int16x4_t __s0_550 = __p0_550; \
55583 int16x4_t __s1_550 = __p1_550; \
55584 int16x8_t __s2_550 = __p2_550; \
55585 int16x4_t __rev0_550; __rev0_550 = __builtin_shufflevector(__s0_550, __s0_550, 3, 2, 1, 0); \
55586 int16x4_t __rev1_550; __rev1_550 = __builtin_shufflevector(__s1_550, __s1_550, 3, 2, 1, 0); \
55587 int16x8_t __rev2_550; __rev2_550 = __builtin_shufflevector(__s2_550, __s2_550, 7, 6, 5, 4, 3, 2, 1, 0); \
55588 __ret_550 = __rev0_550 + __rev1_550 * __noswap_splat_laneq_s16(__rev2_550, __p3_550); \
55589 __ret_550 = __builtin_shufflevector(__ret_550, __ret_550, 3, 2, 1, 0); \
55590 __ret_550; \
55591})
55592#endif
55593
55594#ifdef __LITTLE_ENDIAN__
55595#define vmlal_high_lane_u32(__p0_551, __p1_551, __p2_551, __p3_551) __extension__ ({ \
55596 uint64x2_t __ret_551; \
55597 uint64x2_t __s0_551 = __p0_551; \
55598 uint32x4_t __s1_551 = __p1_551; \
55599 uint32x2_t __s2_551 = __p2_551; \
55600 __ret_551 = __s0_551 + vmull_u32(vget_high_u32(__s1_551), splat_lane_u32(__s2_551, __p3_551)); \
55601 __ret_551; \
55602})
55603#else
55604#define vmlal_high_lane_u32(__p0_552, __p1_552, __p2_552, __p3_552) __extension__ ({ \
55605 uint64x2_t __ret_552; \
55606 uint64x2_t __s0_552 = __p0_552; \
55607 uint32x4_t __s1_552 = __p1_552; \
55608 uint32x2_t __s2_552 = __p2_552; \
55609 uint64x2_t __rev0_552; __rev0_552 = __builtin_shufflevector(__s0_552, __s0_552, 1, 0); \
55610 uint32x4_t __rev1_552; __rev1_552 = __builtin_shufflevector(__s1_552, __s1_552, 3, 2, 1, 0); \
55611 uint32x2_t __rev2_552; __rev2_552 = __builtin_shufflevector(__s2_552, __s2_552, 1, 0); \
55612 __ret_552 = __rev0_552 + __noswap_vmull_u32(__noswap_vget_high_u32(__rev1_552), __noswap_splat_lane_u32(__rev2_552, __p3_552)); \
55613 __ret_552 = __builtin_shufflevector(__ret_552, __ret_552, 1, 0); \
55614 __ret_552; \
55615})
55616#endif
55617
55618#ifdef __LITTLE_ENDIAN__
55619#define vmlal_high_lane_u16(__p0_553, __p1_553, __p2_553, __p3_553) __extension__ ({ \
55620 uint32x4_t __ret_553; \
55621 uint32x4_t __s0_553 = __p0_553; \
55622 uint16x8_t __s1_553 = __p1_553; \
55623 uint16x4_t __s2_553 = __p2_553; \
55624 __ret_553 = __s0_553 + vmull_u16(vget_high_u16(__s1_553), splat_lane_u16(__s2_553, __p3_553)); \
55625 __ret_553; \
55626})
55627#else
55628#define vmlal_high_lane_u16(__p0_554, __p1_554, __p2_554, __p3_554) __extension__ ({ \
55629 uint32x4_t __ret_554; \
55630 uint32x4_t __s0_554 = __p0_554; \
55631 uint16x8_t __s1_554 = __p1_554; \
55632 uint16x4_t __s2_554 = __p2_554; \
55633 uint32x4_t __rev0_554; __rev0_554 = __builtin_shufflevector(__s0_554, __s0_554, 3, 2, 1, 0); \
55634 uint16x8_t __rev1_554; __rev1_554 = __builtin_shufflevector(__s1_554, __s1_554, 7, 6, 5, 4, 3, 2, 1, 0); \
55635 uint16x4_t __rev2_554; __rev2_554 = __builtin_shufflevector(__s2_554, __s2_554, 3, 2, 1, 0); \
55636 __ret_554 = __rev0_554 + __noswap_vmull_u16(__noswap_vget_high_u16(__rev1_554), __noswap_splat_lane_u16(__rev2_554, __p3_554)); \
55637 __ret_554 = __builtin_shufflevector(__ret_554, __ret_554, 3, 2, 1, 0); \
55638 __ret_554; \
55639})
55640#endif
55641
55642#ifdef __LITTLE_ENDIAN__
55643#define vmlal_high_lane_s32(__p0_555, __p1_555, __p2_555, __p3_555) __extension__ ({ \
55644 int64x2_t __ret_555; \
55645 int64x2_t __s0_555 = __p0_555; \
55646 int32x4_t __s1_555 = __p1_555; \
55647 int32x2_t __s2_555 = __p2_555; \
55648 __ret_555 = __s0_555 + vmull_s32(vget_high_s32(__s1_555), splat_lane_s32(__s2_555, __p3_555)); \
55649 __ret_555; \
55650})
55651#else
55652#define vmlal_high_lane_s32(__p0_556, __p1_556, __p2_556, __p3_556) __extension__ ({ \
55653 int64x2_t __ret_556; \
55654 int64x2_t __s0_556 = __p0_556; \
55655 int32x4_t __s1_556 = __p1_556; \
55656 int32x2_t __s2_556 = __p2_556; \
55657 int64x2_t __rev0_556; __rev0_556 = __builtin_shufflevector(__s0_556, __s0_556, 1, 0); \
55658 int32x4_t __rev1_556; __rev1_556 = __builtin_shufflevector(__s1_556, __s1_556, 3, 2, 1, 0); \
55659 int32x2_t __rev2_556; __rev2_556 = __builtin_shufflevector(__s2_556, __s2_556, 1, 0); \
55660 __ret_556 = __rev0_556 + __noswap_vmull_s32(__noswap_vget_high_s32(__rev1_556), __noswap_splat_lane_s32(__rev2_556, __p3_556)); \
55661 __ret_556 = __builtin_shufflevector(__ret_556, __ret_556, 1, 0); \
55662 __ret_556; \
55663})
55664#endif
55665
55666#ifdef __LITTLE_ENDIAN__
55667#define vmlal_high_lane_s16(__p0_557, __p1_557, __p2_557, __p3_557) __extension__ ({ \
55668 int32x4_t __ret_557; \
55669 int32x4_t __s0_557 = __p0_557; \
55670 int16x8_t __s1_557 = __p1_557; \
55671 int16x4_t __s2_557 = __p2_557; \
55672 __ret_557 = __s0_557 + vmull_s16(vget_high_s16(__s1_557), splat_lane_s16(__s2_557, __p3_557)); \
55673 __ret_557; \
55674})
55675#else
55676#define vmlal_high_lane_s16(__p0_558, __p1_558, __p2_558, __p3_558) __extension__ ({ \
55677 int32x4_t __ret_558; \
55678 int32x4_t __s0_558 = __p0_558; \
55679 int16x8_t __s1_558 = __p1_558; \
55680 int16x4_t __s2_558 = __p2_558; \
55681 int32x4_t __rev0_558; __rev0_558 = __builtin_shufflevector(__s0_558, __s0_558, 3, 2, 1, 0); \
55682 int16x8_t __rev1_558; __rev1_558 = __builtin_shufflevector(__s1_558, __s1_558, 7, 6, 5, 4, 3, 2, 1, 0); \
55683 int16x4_t __rev2_558; __rev2_558 = __builtin_shufflevector(__s2_558, __s2_558, 3, 2, 1, 0); \
55684 __ret_558 = __rev0_558 + __noswap_vmull_s16(__noswap_vget_high_s16(__rev1_558), __noswap_splat_lane_s16(__rev2_558, __p3_558)); \
55685 __ret_558 = __builtin_shufflevector(__ret_558, __ret_558, 3, 2, 1, 0); \
55686 __ret_558; \
55687})
55688#endif
55689
55690#ifdef __LITTLE_ENDIAN__
55691#define vmlal_high_laneq_u32(__p0_559, __p1_559, __p2_559, __p3_559) __extension__ ({ \
55692 uint64x2_t __ret_559; \
55693 uint64x2_t __s0_559 = __p0_559; \
55694 uint32x4_t __s1_559 = __p1_559; \
55695 uint32x4_t __s2_559 = __p2_559; \
55696 __ret_559 = __s0_559 + vmull_u32(vget_high_u32(__s1_559), splat_laneq_u32(__s2_559, __p3_559)); \
55697 __ret_559; \
55698})
55699#else
55700#define vmlal_high_laneq_u32(__p0_560, __p1_560, __p2_560, __p3_560) __extension__ ({ \
55701 uint64x2_t __ret_560; \
55702 uint64x2_t __s0_560 = __p0_560; \
55703 uint32x4_t __s1_560 = __p1_560; \
55704 uint32x4_t __s2_560 = __p2_560; \
55705 uint64x2_t __rev0_560; __rev0_560 = __builtin_shufflevector(__s0_560, __s0_560, 1, 0); \
55706 uint32x4_t __rev1_560; __rev1_560 = __builtin_shufflevector(__s1_560, __s1_560, 3, 2, 1, 0); \
55707 uint32x4_t __rev2_560; __rev2_560 = __builtin_shufflevector(__s2_560, __s2_560, 3, 2, 1, 0); \
55708 __ret_560 = __rev0_560 + __noswap_vmull_u32(__noswap_vget_high_u32(__rev1_560), __noswap_splat_laneq_u32(__rev2_560, __p3_560)); \
55709 __ret_560 = __builtin_shufflevector(__ret_560, __ret_560, 1, 0); \
55710 __ret_560; \
55711})
55712#endif
55713
55714#ifdef __LITTLE_ENDIAN__
55715#define vmlal_high_laneq_u16(__p0_561, __p1_561, __p2_561, __p3_561) __extension__ ({ \
55716 uint32x4_t __ret_561; \
55717 uint32x4_t __s0_561 = __p0_561; \
55718 uint16x8_t __s1_561 = __p1_561; \
55719 uint16x8_t __s2_561 = __p2_561; \
55720 __ret_561 = __s0_561 + vmull_u16(vget_high_u16(__s1_561), splat_laneq_u16(__s2_561, __p3_561)); \
55721 __ret_561; \
55722})
55723#else
55724#define vmlal_high_laneq_u16(__p0_562, __p1_562, __p2_562, __p3_562) __extension__ ({ \
55725 uint32x4_t __ret_562; \
55726 uint32x4_t __s0_562 = __p0_562; \
55727 uint16x8_t __s1_562 = __p1_562; \
55728 uint16x8_t __s2_562 = __p2_562; \
55729 uint32x4_t __rev0_562; __rev0_562 = __builtin_shufflevector(__s0_562, __s0_562, 3, 2, 1, 0); \
55730 uint16x8_t __rev1_562; __rev1_562 = __builtin_shufflevector(__s1_562, __s1_562, 7, 6, 5, 4, 3, 2, 1, 0); \
55731 uint16x8_t __rev2_562; __rev2_562 = __builtin_shufflevector(__s2_562, __s2_562, 7, 6, 5, 4, 3, 2, 1, 0); \
55732 __ret_562 = __rev0_562 + __noswap_vmull_u16(__noswap_vget_high_u16(__rev1_562), __noswap_splat_laneq_u16(__rev2_562, __p3_562)); \
55733 __ret_562 = __builtin_shufflevector(__ret_562, __ret_562, 3, 2, 1, 0); \
55734 __ret_562; \
55735})
55736#endif
55737
55738#ifdef __LITTLE_ENDIAN__
55739#define vmlal_high_laneq_s32(__p0_563, __p1_563, __p2_563, __p3_563) __extension__ ({ \
55740 int64x2_t __ret_563; \
55741 int64x2_t __s0_563 = __p0_563; \
55742 int32x4_t __s1_563 = __p1_563; \
55743 int32x4_t __s2_563 = __p2_563; \
55744 __ret_563 = __s0_563 + vmull_s32(vget_high_s32(__s1_563), splat_laneq_s32(__s2_563, __p3_563)); \
55745 __ret_563; \
55746})
55747#else
55748#define vmlal_high_laneq_s32(__p0_564, __p1_564, __p2_564, __p3_564) __extension__ ({ \
55749 int64x2_t __ret_564; \
55750 int64x2_t __s0_564 = __p0_564; \
55751 int32x4_t __s1_564 = __p1_564; \
55752 int32x4_t __s2_564 = __p2_564; \
55753 int64x2_t __rev0_564; __rev0_564 = __builtin_shufflevector(__s0_564, __s0_564, 1, 0); \
55754 int32x4_t __rev1_564; __rev1_564 = __builtin_shufflevector(__s1_564, __s1_564, 3, 2, 1, 0); \
55755 int32x4_t __rev2_564; __rev2_564 = __builtin_shufflevector(__s2_564, __s2_564, 3, 2, 1, 0); \
55756 __ret_564 = __rev0_564 + __noswap_vmull_s32(__noswap_vget_high_s32(__rev1_564), __noswap_splat_laneq_s32(__rev2_564, __p3_564)); \
55757 __ret_564 = __builtin_shufflevector(__ret_564, __ret_564, 1, 0); \
55758 __ret_564; \
55759})
55760#endif
55761
55762#ifdef __LITTLE_ENDIAN__
55763#define vmlal_high_laneq_s16(__p0_565, __p1_565, __p2_565, __p3_565) __extension__ ({ \
55764 int32x4_t __ret_565; \
55765 int32x4_t __s0_565 = __p0_565; \
55766 int16x8_t __s1_565 = __p1_565; \
55767 int16x8_t __s2_565 = __p2_565; \
55768 __ret_565 = __s0_565 + vmull_s16(vget_high_s16(__s1_565), splat_laneq_s16(__s2_565, __p3_565)); \
55769 __ret_565; \
55770})
55771#else
55772#define vmlal_high_laneq_s16(__p0_566, __p1_566, __p2_566, __p3_566) __extension__ ({ \
55773 int32x4_t __ret_566; \
55774 int32x4_t __s0_566 = __p0_566; \
55775 int16x8_t __s1_566 = __p1_566; \
55776 int16x8_t __s2_566 = __p2_566; \
55777 int32x4_t __rev0_566; __rev0_566 = __builtin_shufflevector(__s0_566, __s0_566, 3, 2, 1, 0); \
55778 int16x8_t __rev1_566; __rev1_566 = __builtin_shufflevector(__s1_566, __s1_566, 7, 6, 5, 4, 3, 2, 1, 0); \
55779 int16x8_t __rev2_566; __rev2_566 = __builtin_shufflevector(__s2_566, __s2_566, 7, 6, 5, 4, 3, 2, 1, 0); \
55780 __ret_566 = __rev0_566 + __noswap_vmull_s16(__noswap_vget_high_s16(__rev1_566), __noswap_splat_laneq_s16(__rev2_566, __p3_566)); \
55781 __ret_566 = __builtin_shufflevector(__ret_566, __ret_566, 3, 2, 1, 0); \
55782 __ret_566; \
55783})
55784#endif
55785
55786#ifdef __LITTLE_ENDIAN__
55787#define vmlal_laneq_u32(__p0_567, __p1_567, __p2_567, __p3_567) __extension__ ({ \
55788 uint64x2_t __ret_567; \
55789 uint64x2_t __s0_567 = __p0_567; \
55790 uint32x2_t __s1_567 = __p1_567; \
55791 uint32x4_t __s2_567 = __p2_567; \
55792 __ret_567 = __s0_567 + vmull_u32(__s1_567, splat_laneq_u32(__s2_567, __p3_567)); \
55793 __ret_567; \
55794})
55795#else
55796#define vmlal_laneq_u32(__p0_568, __p1_568, __p2_568, __p3_568) __extension__ ({ \
55797 uint64x2_t __ret_568; \
55798 uint64x2_t __s0_568 = __p0_568; \
55799 uint32x2_t __s1_568 = __p1_568; \
55800 uint32x4_t __s2_568 = __p2_568; \
55801 uint64x2_t __rev0_568; __rev0_568 = __builtin_shufflevector(__s0_568, __s0_568, 1, 0); \
55802 uint32x2_t __rev1_568; __rev1_568 = __builtin_shufflevector(__s1_568, __s1_568, 1, 0); \
55803 uint32x4_t __rev2_568; __rev2_568 = __builtin_shufflevector(__s2_568, __s2_568, 3, 2, 1, 0); \
55804 __ret_568 = __rev0_568 + __noswap_vmull_u32(__rev1_568, __noswap_splat_laneq_u32(__rev2_568, __p3_568)); \
55805 __ret_568 = __builtin_shufflevector(__ret_568, __ret_568, 1, 0); \
55806 __ret_568; \
55807})
55808#endif
55809
55810#ifdef __LITTLE_ENDIAN__
55811#define vmlal_laneq_u16(__p0_569, __p1_569, __p2_569, __p3_569) __extension__ ({ \
55812 uint32x4_t __ret_569; \
55813 uint32x4_t __s0_569 = __p0_569; \
55814 uint16x4_t __s1_569 = __p1_569; \
55815 uint16x8_t __s2_569 = __p2_569; \
55816 __ret_569 = __s0_569 + vmull_u16(__s1_569, splat_laneq_u16(__s2_569, __p3_569)); \
55817 __ret_569; \
55818})
55819#else
55820#define vmlal_laneq_u16(__p0_570, __p1_570, __p2_570, __p3_570) __extension__ ({ \
55821 uint32x4_t __ret_570; \
55822 uint32x4_t __s0_570 = __p0_570; \
55823 uint16x4_t __s1_570 = __p1_570; \
55824 uint16x8_t __s2_570 = __p2_570; \
55825 uint32x4_t __rev0_570; __rev0_570 = __builtin_shufflevector(__s0_570, __s0_570, 3, 2, 1, 0); \
55826 uint16x4_t __rev1_570; __rev1_570 = __builtin_shufflevector(__s1_570, __s1_570, 3, 2, 1, 0); \
55827 uint16x8_t __rev2_570; __rev2_570 = __builtin_shufflevector(__s2_570, __s2_570, 7, 6, 5, 4, 3, 2, 1, 0); \
55828 __ret_570 = __rev0_570 + __noswap_vmull_u16(__rev1_570, __noswap_splat_laneq_u16(__rev2_570, __p3_570)); \
55829 __ret_570 = __builtin_shufflevector(__ret_570, __ret_570, 3, 2, 1, 0); \
55830 __ret_570; \
55831})
55832#endif
55833
55834#ifdef __LITTLE_ENDIAN__
55835#define vmlal_laneq_s32(__p0_571, __p1_571, __p2_571, __p3_571) __extension__ ({ \
55836 int64x2_t __ret_571; \
55837 int64x2_t __s0_571 = __p0_571; \
55838 int32x2_t __s1_571 = __p1_571; \
55839 int32x4_t __s2_571 = __p2_571; \
55840 __ret_571 = __s0_571 + vmull_s32(__s1_571, splat_laneq_s32(__s2_571, __p3_571)); \
55841 __ret_571; \
55842})
55843#else
55844#define vmlal_laneq_s32(__p0_572, __p1_572, __p2_572, __p3_572) __extension__ ({ \
55845 int64x2_t __ret_572; \
55846 int64x2_t __s0_572 = __p0_572; \
55847 int32x2_t __s1_572 = __p1_572; \
55848 int32x4_t __s2_572 = __p2_572; \
55849 int64x2_t __rev0_572; __rev0_572 = __builtin_shufflevector(__s0_572, __s0_572, 1, 0); \
55850 int32x2_t __rev1_572; __rev1_572 = __builtin_shufflevector(__s1_572, __s1_572, 1, 0); \
55851 int32x4_t __rev2_572; __rev2_572 = __builtin_shufflevector(__s2_572, __s2_572, 3, 2, 1, 0); \
55852 __ret_572 = __rev0_572 + __noswap_vmull_s32(__rev1_572, __noswap_splat_laneq_s32(__rev2_572, __p3_572)); \
55853 __ret_572 = __builtin_shufflevector(__ret_572, __ret_572, 1, 0); \
55854 __ret_572; \
55855})
55856#endif
55857
55858#ifdef __LITTLE_ENDIAN__
55859#define vmlal_laneq_s16(__p0_573, __p1_573, __p2_573, __p3_573) __extension__ ({ \
55860 int32x4_t __ret_573; \
55861 int32x4_t __s0_573 = __p0_573; \
55862 int16x4_t __s1_573 = __p1_573; \
55863 int16x8_t __s2_573 = __p2_573; \
55864 __ret_573 = __s0_573 + vmull_s16(__s1_573, splat_laneq_s16(__s2_573, __p3_573)); \
55865 __ret_573; \
55866})
55867#else
55868#define vmlal_laneq_s16(__p0_574, __p1_574, __p2_574, __p3_574) __extension__ ({ \
55869 int32x4_t __ret_574; \
55870 int32x4_t __s0_574 = __p0_574; \
55871 int16x4_t __s1_574 = __p1_574; \
55872 int16x8_t __s2_574 = __p2_574; \
55873 int32x4_t __rev0_574; __rev0_574 = __builtin_shufflevector(__s0_574, __s0_574, 3, 2, 1, 0); \
55874 int16x4_t __rev1_574; __rev1_574 = __builtin_shufflevector(__s1_574, __s1_574, 3, 2, 1, 0); \
55875 int16x8_t __rev2_574; __rev2_574 = __builtin_shufflevector(__s2_574, __s2_574, 7, 6, 5, 4, 3, 2, 1, 0); \
55876 __ret_574 = __rev0_574 + __noswap_vmull_s16(__rev1_574, __noswap_splat_laneq_s16(__rev2_574, __p3_574)); \
55877 __ret_574 = __builtin_shufflevector(__ret_574, __ret_574, 3, 2, 1, 0); \
55878 __ret_574; \
55879})
55880#endif
55881
55882#ifdef __LITTLE_ENDIAN__
55883__ai float64x2_t vmlsq_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
55884 float64x2_t __ret;
55885 __ret = __p0 - __p1 * __p2;
57267__ai float16x8_t vreinterpretq_f16_p128(poly128_t __p0) {
57268 float16x8_t __ret;
57269 __ret = (float16x8_t)(__p0);
5588657270 return __ret;
5588757271}
55888#else
55889__ai float64x2_t vmlsq_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
55890 float64x2_t __ret;
55891 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
55892 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
55893 float64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
55894 __ret = __rev0 - __rev1 * __rev2;
55895 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
57272__ai float16x8_t vreinterpretq_f16_p64(poly64x2_t __p0) {
57273 float16x8_t __ret;
57274 __ret = (float16x8_t)(__p0);
5589657275 return __ret;
5589757276}
55898#endif
55899
55900__ai float64x1_t vmls_f64(float64x1_t __p0, float64x1_t __p1, float64x1_t __p2) {
55901 float64x1_t __ret;
55902 __ret = __p0 - __p1 * __p2;
57277__ai float16x8_t vreinterpretq_f16_p16(poly16x8_t __p0) {
57278 float16x8_t __ret;
57279 __ret = (float16x8_t)(__p0);
5590357280 return __ret;
5590457281}
55905#ifdef __LITTLE_ENDIAN__
55906#define vmlsq_laneq_u32(__p0_575, __p1_575, __p2_575, __p3_575) __extension__ ({ \
55907 uint32x4_t __ret_575; \
55908 uint32x4_t __s0_575 = __p0_575; \
55909 uint32x4_t __s1_575 = __p1_575; \
55910 uint32x4_t __s2_575 = __p2_575; \
55911 __ret_575 = __s0_575 - __s1_575 * splatq_laneq_u32(__s2_575, __p3_575); \
55912 __ret_575; \
55913})
55914#else
55915#define vmlsq_laneq_u32(__p0_576, __p1_576, __p2_576, __p3_576) __extension__ ({ \
55916 uint32x4_t __ret_576; \
55917 uint32x4_t __s0_576 = __p0_576; \
55918 uint32x4_t __s1_576 = __p1_576; \
55919 uint32x4_t __s2_576 = __p2_576; \
55920 uint32x4_t __rev0_576; __rev0_576 = __builtin_shufflevector(__s0_576, __s0_576, 3, 2, 1, 0); \
55921 uint32x4_t __rev1_576; __rev1_576 = __builtin_shufflevector(__s1_576, __s1_576, 3, 2, 1, 0); \
55922 uint32x4_t __rev2_576; __rev2_576 = __builtin_shufflevector(__s2_576, __s2_576, 3, 2, 1, 0); \
55923 __ret_576 = __rev0_576 - __rev1_576 * __noswap_splatq_laneq_u32(__rev2_576, __p3_576); \
55924 __ret_576 = __builtin_shufflevector(__ret_576, __ret_576, 3, 2, 1, 0); \
55925 __ret_576; \
55926})
55927#endif
55928
55929#ifdef __LITTLE_ENDIAN__
55930#define vmlsq_laneq_u16(__p0_577, __p1_577, __p2_577, __p3_577) __extension__ ({ \
55931 uint16x8_t __ret_577; \
55932 uint16x8_t __s0_577 = __p0_577; \
55933 uint16x8_t __s1_577 = __p1_577; \
55934 uint16x8_t __s2_577 = __p2_577; \
55935 __ret_577 = __s0_577 - __s1_577 * splatq_laneq_u16(__s2_577, __p3_577); \
55936 __ret_577; \
55937})
55938#else
55939#define vmlsq_laneq_u16(__p0_578, __p1_578, __p2_578, __p3_578) __extension__ ({ \
55940 uint16x8_t __ret_578; \
55941 uint16x8_t __s0_578 = __p0_578; \
55942 uint16x8_t __s1_578 = __p1_578; \
55943 uint16x8_t __s2_578 = __p2_578; \
55944 uint16x8_t __rev0_578; __rev0_578 = __builtin_shufflevector(__s0_578, __s0_578, 7, 6, 5, 4, 3, 2, 1, 0); \
55945 uint16x8_t __rev1_578; __rev1_578 = __builtin_shufflevector(__s1_578, __s1_578, 7, 6, 5, 4, 3, 2, 1, 0); \
55946 uint16x8_t __rev2_578; __rev2_578 = __builtin_shufflevector(__s2_578, __s2_578, 7, 6, 5, 4, 3, 2, 1, 0); \
55947 __ret_578 = __rev0_578 - __rev1_578 * __noswap_splatq_laneq_u16(__rev2_578, __p3_578); \
55948 __ret_578 = __builtin_shufflevector(__ret_578, __ret_578, 7, 6, 5, 4, 3, 2, 1, 0); \
55949 __ret_578; \
55950})
55951#endif
55952
55953#ifdef __LITTLE_ENDIAN__
55954#define vmlsq_laneq_f32(__p0_579, __p1_579, __p2_579, __p3_579) __extension__ ({ \
55955 float32x4_t __ret_579; \
55956 float32x4_t __s0_579 = __p0_579; \
55957 float32x4_t __s1_579 = __p1_579; \
55958 float32x4_t __s2_579 = __p2_579; \
55959 __ret_579 = __s0_579 - __s1_579 * splatq_laneq_f32(__s2_579, __p3_579); \
55960 __ret_579; \
55961})
55962#else
55963#define vmlsq_laneq_f32(__p0_580, __p1_580, __p2_580, __p3_580) __extension__ ({ \
55964 float32x4_t __ret_580; \
55965 float32x4_t __s0_580 = __p0_580; \
55966 float32x4_t __s1_580 = __p1_580; \
55967 float32x4_t __s2_580 = __p2_580; \
55968 float32x4_t __rev0_580; __rev0_580 = __builtin_shufflevector(__s0_580, __s0_580, 3, 2, 1, 0); \
55969 float32x4_t __rev1_580; __rev1_580 = __builtin_shufflevector(__s1_580, __s1_580, 3, 2, 1, 0); \
55970 float32x4_t __rev2_580; __rev2_580 = __builtin_shufflevector(__s2_580, __s2_580, 3, 2, 1, 0); \
55971 __ret_580 = __rev0_580 - __rev1_580 * __noswap_splatq_laneq_f32(__rev2_580, __p3_580); \
55972 __ret_580 = __builtin_shufflevector(__ret_580, __ret_580, 3, 2, 1, 0); \
55973 __ret_580; \
55974})
55975#endif
55976
55977#ifdef __LITTLE_ENDIAN__
55978#define vmlsq_laneq_s32(__p0_581, __p1_581, __p2_581, __p3_581) __extension__ ({ \
55979 int32x4_t __ret_581; \
55980 int32x4_t __s0_581 = __p0_581; \
55981 int32x4_t __s1_581 = __p1_581; \
55982 int32x4_t __s2_581 = __p2_581; \
55983 __ret_581 = __s0_581 - __s1_581 * splatq_laneq_s32(__s2_581, __p3_581); \
55984 __ret_581; \
55985})
55986#else
55987#define vmlsq_laneq_s32(__p0_582, __p1_582, __p2_582, __p3_582) __extension__ ({ \
55988 int32x4_t __ret_582; \
55989 int32x4_t __s0_582 = __p0_582; \
55990 int32x4_t __s1_582 = __p1_582; \
55991 int32x4_t __s2_582 = __p2_582; \
55992 int32x4_t __rev0_582; __rev0_582 = __builtin_shufflevector(__s0_582, __s0_582, 3, 2, 1, 0); \
55993 int32x4_t __rev1_582; __rev1_582 = __builtin_shufflevector(__s1_582, __s1_582, 3, 2, 1, 0); \
55994 int32x4_t __rev2_582; __rev2_582 = __builtin_shufflevector(__s2_582, __s2_582, 3, 2, 1, 0); \
55995 __ret_582 = __rev0_582 - __rev1_582 * __noswap_splatq_laneq_s32(__rev2_582, __p3_582); \
55996 __ret_582 = __builtin_shufflevector(__ret_582, __ret_582, 3, 2, 1, 0); \
55997 __ret_582; \
55998})
55999#endif
56000
56001#ifdef __LITTLE_ENDIAN__
56002#define vmlsq_laneq_s16(__p0_583, __p1_583, __p2_583, __p3_583) __extension__ ({ \
56003 int16x8_t __ret_583; \
56004 int16x8_t __s0_583 = __p0_583; \
56005 int16x8_t __s1_583 = __p1_583; \
56006 int16x8_t __s2_583 = __p2_583; \
56007 __ret_583 = __s0_583 - __s1_583 * splatq_laneq_s16(__s2_583, __p3_583); \
56008 __ret_583; \
56009})
56010#else
56011#define vmlsq_laneq_s16(__p0_584, __p1_584, __p2_584, __p3_584) __extension__ ({ \
56012 int16x8_t __ret_584; \
56013 int16x8_t __s0_584 = __p0_584; \
56014 int16x8_t __s1_584 = __p1_584; \
56015 int16x8_t __s2_584 = __p2_584; \
56016 int16x8_t __rev0_584; __rev0_584 = __builtin_shufflevector(__s0_584, __s0_584, 7, 6, 5, 4, 3, 2, 1, 0); \
56017 int16x8_t __rev1_584; __rev1_584 = __builtin_shufflevector(__s1_584, __s1_584, 7, 6, 5, 4, 3, 2, 1, 0); \
56018 int16x8_t __rev2_584; __rev2_584 = __builtin_shufflevector(__s2_584, __s2_584, 7, 6, 5, 4, 3, 2, 1, 0); \
56019 __ret_584 = __rev0_584 - __rev1_584 * __noswap_splatq_laneq_s16(__rev2_584, __p3_584); \
56020 __ret_584 = __builtin_shufflevector(__ret_584, __ret_584, 7, 6, 5, 4, 3, 2, 1, 0); \
56021 __ret_584; \
56022})
56023#endif
56024
56025#ifdef __LITTLE_ENDIAN__
56026#define vmls_laneq_u32(__p0_585, __p1_585, __p2_585, __p3_585) __extension__ ({ \
56027 uint32x2_t __ret_585; \
56028 uint32x2_t __s0_585 = __p0_585; \
56029 uint32x2_t __s1_585 = __p1_585; \
56030 uint32x4_t __s2_585 = __p2_585; \
56031 __ret_585 = __s0_585 - __s1_585 * splat_laneq_u32(__s2_585, __p3_585); \
56032 __ret_585; \
56033})
56034#else
56035#define vmls_laneq_u32(__p0_586, __p1_586, __p2_586, __p3_586) __extension__ ({ \
56036 uint32x2_t __ret_586; \
56037 uint32x2_t __s0_586 = __p0_586; \
56038 uint32x2_t __s1_586 = __p1_586; \
56039 uint32x4_t __s2_586 = __p2_586; \
56040 uint32x2_t __rev0_586; __rev0_586 = __builtin_shufflevector(__s0_586, __s0_586, 1, 0); \
56041 uint32x2_t __rev1_586; __rev1_586 = __builtin_shufflevector(__s1_586, __s1_586, 1, 0); \
56042 uint32x4_t __rev2_586; __rev2_586 = __builtin_shufflevector(__s2_586, __s2_586, 3, 2, 1, 0); \
56043 __ret_586 = __rev0_586 - __rev1_586 * __noswap_splat_laneq_u32(__rev2_586, __p3_586); \
56044 __ret_586 = __builtin_shufflevector(__ret_586, __ret_586, 1, 0); \
56045 __ret_586; \
56046})
56047#endif
56048
56049#ifdef __LITTLE_ENDIAN__
56050#define vmls_laneq_u16(__p0_587, __p1_587, __p2_587, __p3_587) __extension__ ({ \
56051 uint16x4_t __ret_587; \
56052 uint16x4_t __s0_587 = __p0_587; \
56053 uint16x4_t __s1_587 = __p1_587; \
56054 uint16x8_t __s2_587 = __p2_587; \
56055 __ret_587 = __s0_587 - __s1_587 * splat_laneq_u16(__s2_587, __p3_587); \
56056 __ret_587; \
56057})
56058#else
56059#define vmls_laneq_u16(__p0_588, __p1_588, __p2_588, __p3_588) __extension__ ({ \
56060 uint16x4_t __ret_588; \
56061 uint16x4_t __s0_588 = __p0_588; \
56062 uint16x4_t __s1_588 = __p1_588; \
56063 uint16x8_t __s2_588 = __p2_588; \
56064 uint16x4_t __rev0_588; __rev0_588 = __builtin_shufflevector(__s0_588, __s0_588, 3, 2, 1, 0); \
56065 uint16x4_t __rev1_588; __rev1_588 = __builtin_shufflevector(__s1_588, __s1_588, 3, 2, 1, 0); \
56066 uint16x8_t __rev2_588; __rev2_588 = __builtin_shufflevector(__s2_588, __s2_588, 7, 6, 5, 4, 3, 2, 1, 0); \
56067 __ret_588 = __rev0_588 - __rev1_588 * __noswap_splat_laneq_u16(__rev2_588, __p3_588); \
56068 __ret_588 = __builtin_shufflevector(__ret_588, __ret_588, 3, 2, 1, 0); \
56069 __ret_588; \
56070})
56071#endif
56072
56073#ifdef __LITTLE_ENDIAN__
56074#define vmls_laneq_f32(__p0_589, __p1_589, __p2_589, __p3_589) __extension__ ({ \
56075 float32x2_t __ret_589; \
56076 float32x2_t __s0_589 = __p0_589; \
56077 float32x2_t __s1_589 = __p1_589; \
56078 float32x4_t __s2_589 = __p2_589; \
56079 __ret_589 = __s0_589 - __s1_589 * splat_laneq_f32(__s2_589, __p3_589); \
56080 __ret_589; \
56081})
56082#else
56083#define vmls_laneq_f32(__p0_590, __p1_590, __p2_590, __p3_590) __extension__ ({ \
56084 float32x2_t __ret_590; \
56085 float32x2_t __s0_590 = __p0_590; \
56086 float32x2_t __s1_590 = __p1_590; \
56087 float32x4_t __s2_590 = __p2_590; \
56088 float32x2_t __rev0_590; __rev0_590 = __builtin_shufflevector(__s0_590, __s0_590, 1, 0); \
56089 float32x2_t __rev1_590; __rev1_590 = __builtin_shufflevector(__s1_590, __s1_590, 1, 0); \
56090 float32x4_t __rev2_590; __rev2_590 = __builtin_shufflevector(__s2_590, __s2_590, 3, 2, 1, 0); \
56091 __ret_590 = __rev0_590 - __rev1_590 * __noswap_splat_laneq_f32(__rev2_590, __p3_590); \
56092 __ret_590 = __builtin_shufflevector(__ret_590, __ret_590, 1, 0); \
56093 __ret_590; \
56094})
56095#endif
56096
56097#ifdef __LITTLE_ENDIAN__
56098#define vmls_laneq_s32(__p0_591, __p1_591, __p2_591, __p3_591) __extension__ ({ \
56099 int32x2_t __ret_591; \
56100 int32x2_t __s0_591 = __p0_591; \
56101 int32x2_t __s1_591 = __p1_591; \
56102 int32x4_t __s2_591 = __p2_591; \
56103 __ret_591 = __s0_591 - __s1_591 * splat_laneq_s32(__s2_591, __p3_591); \
56104 __ret_591; \
56105})
56106#else
56107#define vmls_laneq_s32(__p0_592, __p1_592, __p2_592, __p3_592) __extension__ ({ \
56108 int32x2_t __ret_592; \
56109 int32x2_t __s0_592 = __p0_592; \
56110 int32x2_t __s1_592 = __p1_592; \
56111 int32x4_t __s2_592 = __p2_592; \
56112 int32x2_t __rev0_592; __rev0_592 = __builtin_shufflevector(__s0_592, __s0_592, 1, 0); \
56113 int32x2_t __rev1_592; __rev1_592 = __builtin_shufflevector(__s1_592, __s1_592, 1, 0); \
56114 int32x4_t __rev2_592; __rev2_592 = __builtin_shufflevector(__s2_592, __s2_592, 3, 2, 1, 0); \
56115 __ret_592 = __rev0_592 - __rev1_592 * __noswap_splat_laneq_s32(__rev2_592, __p3_592); \
56116 __ret_592 = __builtin_shufflevector(__ret_592, __ret_592, 1, 0); \
56117 __ret_592; \
56118})
56119#endif
56120
56121#ifdef __LITTLE_ENDIAN__
56122#define vmls_laneq_s16(__p0_593, __p1_593, __p2_593, __p3_593) __extension__ ({ \
56123 int16x4_t __ret_593; \
56124 int16x4_t __s0_593 = __p0_593; \
56125 int16x4_t __s1_593 = __p1_593; \
56126 int16x8_t __s2_593 = __p2_593; \
56127 __ret_593 = __s0_593 - __s1_593 * splat_laneq_s16(__s2_593, __p3_593); \
56128 __ret_593; \
56129})
56130#else
56131#define vmls_laneq_s16(__p0_594, __p1_594, __p2_594, __p3_594) __extension__ ({ \
56132 int16x4_t __ret_594; \
56133 int16x4_t __s0_594 = __p0_594; \
56134 int16x4_t __s1_594 = __p1_594; \
56135 int16x8_t __s2_594 = __p2_594; \
56136 int16x4_t __rev0_594; __rev0_594 = __builtin_shufflevector(__s0_594, __s0_594, 3, 2, 1, 0); \
56137 int16x4_t __rev1_594; __rev1_594 = __builtin_shufflevector(__s1_594, __s1_594, 3, 2, 1, 0); \
56138 int16x8_t __rev2_594; __rev2_594 = __builtin_shufflevector(__s2_594, __s2_594, 7, 6, 5, 4, 3, 2, 1, 0); \
56139 __ret_594 = __rev0_594 - __rev1_594 * __noswap_splat_laneq_s16(__rev2_594, __p3_594); \
56140 __ret_594 = __builtin_shufflevector(__ret_594, __ret_594, 3, 2, 1, 0); \
56141 __ret_594; \
56142})
56143#endif
56144
56145#ifdef __LITTLE_ENDIAN__
56146#define vmlsl_high_lane_u32(__p0_595, __p1_595, __p2_595, __p3_595) __extension__ ({ \
56147 uint64x2_t __ret_595; \
56148 uint64x2_t __s0_595 = __p0_595; \
56149 uint32x4_t __s1_595 = __p1_595; \
56150 uint32x2_t __s2_595 = __p2_595; \
56151 __ret_595 = __s0_595 - vmull_u32(vget_high_u32(__s1_595), splat_lane_u32(__s2_595, __p3_595)); \
56152 __ret_595; \
56153})
56154#else
56155#define vmlsl_high_lane_u32(__p0_596, __p1_596, __p2_596, __p3_596) __extension__ ({ \
56156 uint64x2_t __ret_596; \
56157 uint64x2_t __s0_596 = __p0_596; \
56158 uint32x4_t __s1_596 = __p1_596; \
56159 uint32x2_t __s2_596 = __p2_596; \
56160 uint64x2_t __rev0_596; __rev0_596 = __builtin_shufflevector(__s0_596, __s0_596, 1, 0); \
56161 uint32x4_t __rev1_596; __rev1_596 = __builtin_shufflevector(__s1_596, __s1_596, 3, 2, 1, 0); \
56162 uint32x2_t __rev2_596; __rev2_596 = __builtin_shufflevector(__s2_596, __s2_596, 1, 0); \
56163 __ret_596 = __rev0_596 - __noswap_vmull_u32(__noswap_vget_high_u32(__rev1_596), __noswap_splat_lane_u32(__rev2_596, __p3_596)); \
56164 __ret_596 = __builtin_shufflevector(__ret_596, __ret_596, 1, 0); \
56165 __ret_596; \
56166})
56167#endif
56168
56169#ifdef __LITTLE_ENDIAN__
56170#define vmlsl_high_lane_u16(__p0_597, __p1_597, __p2_597, __p3_597) __extension__ ({ \
56171 uint32x4_t __ret_597; \
56172 uint32x4_t __s0_597 = __p0_597; \
56173 uint16x8_t __s1_597 = __p1_597; \
56174 uint16x4_t __s2_597 = __p2_597; \
56175 __ret_597 = __s0_597 - vmull_u16(vget_high_u16(__s1_597), splat_lane_u16(__s2_597, __p3_597)); \
56176 __ret_597; \
56177})
56178#else
56179#define vmlsl_high_lane_u16(__p0_598, __p1_598, __p2_598, __p3_598) __extension__ ({ \
56180 uint32x4_t __ret_598; \
56181 uint32x4_t __s0_598 = __p0_598; \
56182 uint16x8_t __s1_598 = __p1_598; \
56183 uint16x4_t __s2_598 = __p2_598; \
56184 uint32x4_t __rev0_598; __rev0_598 = __builtin_shufflevector(__s0_598, __s0_598, 3, 2, 1, 0); \
56185 uint16x8_t __rev1_598; __rev1_598 = __builtin_shufflevector(__s1_598, __s1_598, 7, 6, 5, 4, 3, 2, 1, 0); \
56186 uint16x4_t __rev2_598; __rev2_598 = __builtin_shufflevector(__s2_598, __s2_598, 3, 2, 1, 0); \
56187 __ret_598 = __rev0_598 - __noswap_vmull_u16(__noswap_vget_high_u16(__rev1_598), __noswap_splat_lane_u16(__rev2_598, __p3_598)); \
56188 __ret_598 = __builtin_shufflevector(__ret_598, __ret_598, 3, 2, 1, 0); \
56189 __ret_598; \
56190})
56191#endif
56192
56193#ifdef __LITTLE_ENDIAN__
56194#define vmlsl_high_lane_s32(__p0_599, __p1_599, __p2_599, __p3_599) __extension__ ({ \
56195 int64x2_t __ret_599; \
56196 int64x2_t __s0_599 = __p0_599; \
56197 int32x4_t __s1_599 = __p1_599; \
56198 int32x2_t __s2_599 = __p2_599; \
56199 __ret_599 = __s0_599 - vmull_s32(vget_high_s32(__s1_599), splat_lane_s32(__s2_599, __p3_599)); \
56200 __ret_599; \
56201})
56202#else
56203#define vmlsl_high_lane_s32(__p0_600, __p1_600, __p2_600, __p3_600) __extension__ ({ \
56204 int64x2_t __ret_600; \
56205 int64x2_t __s0_600 = __p0_600; \
56206 int32x4_t __s1_600 = __p1_600; \
56207 int32x2_t __s2_600 = __p2_600; \
56208 int64x2_t __rev0_600; __rev0_600 = __builtin_shufflevector(__s0_600, __s0_600, 1, 0); \
56209 int32x4_t __rev1_600; __rev1_600 = __builtin_shufflevector(__s1_600, __s1_600, 3, 2, 1, 0); \
56210 int32x2_t __rev2_600; __rev2_600 = __builtin_shufflevector(__s2_600, __s2_600, 1, 0); \
56211 __ret_600 = __rev0_600 - __noswap_vmull_s32(__noswap_vget_high_s32(__rev1_600), __noswap_splat_lane_s32(__rev2_600, __p3_600)); \
56212 __ret_600 = __builtin_shufflevector(__ret_600, __ret_600, 1, 0); \
56213 __ret_600; \
56214})
56215#endif
56216
56217#ifdef __LITTLE_ENDIAN__
56218#define vmlsl_high_lane_s16(__p0_601, __p1_601, __p2_601, __p3_601) __extension__ ({ \
56219 int32x4_t __ret_601; \
56220 int32x4_t __s0_601 = __p0_601; \
56221 int16x8_t __s1_601 = __p1_601; \
56222 int16x4_t __s2_601 = __p2_601; \
56223 __ret_601 = __s0_601 - vmull_s16(vget_high_s16(__s1_601), splat_lane_s16(__s2_601, __p3_601)); \
56224 __ret_601; \
56225})
56226#else
56227#define vmlsl_high_lane_s16(__p0_602, __p1_602, __p2_602, __p3_602) __extension__ ({ \
56228 int32x4_t __ret_602; \
56229 int32x4_t __s0_602 = __p0_602; \
56230 int16x8_t __s1_602 = __p1_602; \
56231 int16x4_t __s2_602 = __p2_602; \
56232 int32x4_t __rev0_602; __rev0_602 = __builtin_shufflevector(__s0_602, __s0_602, 3, 2, 1, 0); \
56233 int16x8_t __rev1_602; __rev1_602 = __builtin_shufflevector(__s1_602, __s1_602, 7, 6, 5, 4, 3, 2, 1, 0); \
56234 int16x4_t __rev2_602; __rev2_602 = __builtin_shufflevector(__s2_602, __s2_602, 3, 2, 1, 0); \
56235 __ret_602 = __rev0_602 - __noswap_vmull_s16(__noswap_vget_high_s16(__rev1_602), __noswap_splat_lane_s16(__rev2_602, __p3_602)); \
56236 __ret_602 = __builtin_shufflevector(__ret_602, __ret_602, 3, 2, 1, 0); \
56237 __ret_602; \
56238})
56239#endif
56240
56241#ifdef __LITTLE_ENDIAN__
56242#define vmlsl_high_laneq_u32(__p0_603, __p1_603, __p2_603, __p3_603) __extension__ ({ \
56243 uint64x2_t __ret_603; \
56244 uint64x2_t __s0_603 = __p0_603; \
56245 uint32x4_t __s1_603 = __p1_603; \
56246 uint32x4_t __s2_603 = __p2_603; \
56247 __ret_603 = __s0_603 - vmull_u32(vget_high_u32(__s1_603), splat_laneq_u32(__s2_603, __p3_603)); \
56248 __ret_603; \
56249})
56250#else
56251#define vmlsl_high_laneq_u32(__p0_604, __p1_604, __p2_604, __p3_604) __extension__ ({ \
56252 uint64x2_t __ret_604; \
56253 uint64x2_t __s0_604 = __p0_604; \
56254 uint32x4_t __s1_604 = __p1_604; \
56255 uint32x4_t __s2_604 = __p2_604; \
56256 uint64x2_t __rev0_604; __rev0_604 = __builtin_shufflevector(__s0_604, __s0_604, 1, 0); \
56257 uint32x4_t __rev1_604; __rev1_604 = __builtin_shufflevector(__s1_604, __s1_604, 3, 2, 1, 0); \
56258 uint32x4_t __rev2_604; __rev2_604 = __builtin_shufflevector(__s2_604, __s2_604, 3, 2, 1, 0); \
56259 __ret_604 = __rev0_604 - __noswap_vmull_u32(__noswap_vget_high_u32(__rev1_604), __noswap_splat_laneq_u32(__rev2_604, __p3_604)); \
56260 __ret_604 = __builtin_shufflevector(__ret_604, __ret_604, 1, 0); \
56261 __ret_604; \
56262})
56263#endif
56264
56265#ifdef __LITTLE_ENDIAN__
56266#define vmlsl_high_laneq_u16(__p0_605, __p1_605, __p2_605, __p3_605) __extension__ ({ \
56267 uint32x4_t __ret_605; \
56268 uint32x4_t __s0_605 = __p0_605; \
56269 uint16x8_t __s1_605 = __p1_605; \
56270 uint16x8_t __s2_605 = __p2_605; \
56271 __ret_605 = __s0_605 - vmull_u16(vget_high_u16(__s1_605), splat_laneq_u16(__s2_605, __p3_605)); \
56272 __ret_605; \
56273})
56274#else
56275#define vmlsl_high_laneq_u16(__p0_606, __p1_606, __p2_606, __p3_606) __extension__ ({ \
56276 uint32x4_t __ret_606; \
56277 uint32x4_t __s0_606 = __p0_606; \
56278 uint16x8_t __s1_606 = __p1_606; \
56279 uint16x8_t __s2_606 = __p2_606; \
56280 uint32x4_t __rev0_606; __rev0_606 = __builtin_shufflevector(__s0_606, __s0_606, 3, 2, 1, 0); \
56281 uint16x8_t __rev1_606; __rev1_606 = __builtin_shufflevector(__s1_606, __s1_606, 7, 6, 5, 4, 3, 2, 1, 0); \
56282 uint16x8_t __rev2_606; __rev2_606 = __builtin_shufflevector(__s2_606, __s2_606, 7, 6, 5, 4, 3, 2, 1, 0); \
56283 __ret_606 = __rev0_606 - __noswap_vmull_u16(__noswap_vget_high_u16(__rev1_606), __noswap_splat_laneq_u16(__rev2_606, __p3_606)); \
56284 __ret_606 = __builtin_shufflevector(__ret_606, __ret_606, 3, 2, 1, 0); \
56285 __ret_606; \
56286})
56287#endif
56288
56289#ifdef __LITTLE_ENDIAN__
56290#define vmlsl_high_laneq_s32(__p0_607, __p1_607, __p2_607, __p3_607) __extension__ ({ \
56291 int64x2_t __ret_607; \
56292 int64x2_t __s0_607 = __p0_607; \
56293 int32x4_t __s1_607 = __p1_607; \
56294 int32x4_t __s2_607 = __p2_607; \
56295 __ret_607 = __s0_607 - vmull_s32(vget_high_s32(__s1_607), splat_laneq_s32(__s2_607, __p3_607)); \
56296 __ret_607; \
56297})
56298#else
56299#define vmlsl_high_laneq_s32(__p0_608, __p1_608, __p2_608, __p3_608) __extension__ ({ \
56300 int64x2_t __ret_608; \
56301 int64x2_t __s0_608 = __p0_608; \
56302 int32x4_t __s1_608 = __p1_608; \
56303 int32x4_t __s2_608 = __p2_608; \
56304 int64x2_t __rev0_608; __rev0_608 = __builtin_shufflevector(__s0_608, __s0_608, 1, 0); \
56305 int32x4_t __rev1_608; __rev1_608 = __builtin_shufflevector(__s1_608, __s1_608, 3, 2, 1, 0); \
56306 int32x4_t __rev2_608; __rev2_608 = __builtin_shufflevector(__s2_608, __s2_608, 3, 2, 1, 0); \
56307 __ret_608 = __rev0_608 - __noswap_vmull_s32(__noswap_vget_high_s32(__rev1_608), __noswap_splat_laneq_s32(__rev2_608, __p3_608)); \
56308 __ret_608 = __builtin_shufflevector(__ret_608, __ret_608, 1, 0); \
56309 __ret_608; \
56310})
56311#endif
56312
56313#ifdef __LITTLE_ENDIAN__
56314#define vmlsl_high_laneq_s16(__p0_609, __p1_609, __p2_609, __p3_609) __extension__ ({ \
56315 int32x4_t __ret_609; \
56316 int32x4_t __s0_609 = __p0_609; \
56317 int16x8_t __s1_609 = __p1_609; \
56318 int16x8_t __s2_609 = __p2_609; \
56319 __ret_609 = __s0_609 - vmull_s16(vget_high_s16(__s1_609), splat_laneq_s16(__s2_609, __p3_609)); \
56320 __ret_609; \
56321})
56322#else
56323#define vmlsl_high_laneq_s16(__p0_610, __p1_610, __p2_610, __p3_610) __extension__ ({ \
56324 int32x4_t __ret_610; \
56325 int32x4_t __s0_610 = __p0_610; \
56326 int16x8_t __s1_610 = __p1_610; \
56327 int16x8_t __s2_610 = __p2_610; \
56328 int32x4_t __rev0_610; __rev0_610 = __builtin_shufflevector(__s0_610, __s0_610, 3, 2, 1, 0); \
56329 int16x8_t __rev1_610; __rev1_610 = __builtin_shufflevector(__s1_610, __s1_610, 7, 6, 5, 4, 3, 2, 1, 0); \
56330 int16x8_t __rev2_610; __rev2_610 = __builtin_shufflevector(__s2_610, __s2_610, 7, 6, 5, 4, 3, 2, 1, 0); \
56331 __ret_610 = __rev0_610 - __noswap_vmull_s16(__noswap_vget_high_s16(__rev1_610), __noswap_splat_laneq_s16(__rev2_610, __p3_610)); \
56332 __ret_610 = __builtin_shufflevector(__ret_610, __ret_610, 3, 2, 1, 0); \
56333 __ret_610; \
56334})
56335#endif
56336
56337#ifdef __LITTLE_ENDIAN__
56338#define vmlsl_laneq_u32(__p0_611, __p1_611, __p2_611, __p3_611) __extension__ ({ \
56339 uint64x2_t __ret_611; \
56340 uint64x2_t __s0_611 = __p0_611; \
56341 uint32x2_t __s1_611 = __p1_611; \
56342 uint32x4_t __s2_611 = __p2_611; \
56343 __ret_611 = __s0_611 - vmull_u32(__s1_611, splat_laneq_u32(__s2_611, __p3_611)); \
56344 __ret_611; \
56345})
56346#else
56347#define vmlsl_laneq_u32(__p0_612, __p1_612, __p2_612, __p3_612) __extension__ ({ \
56348 uint64x2_t __ret_612; \
56349 uint64x2_t __s0_612 = __p0_612; \
56350 uint32x2_t __s1_612 = __p1_612; \
56351 uint32x4_t __s2_612 = __p2_612; \
56352 uint64x2_t __rev0_612; __rev0_612 = __builtin_shufflevector(__s0_612, __s0_612, 1, 0); \
56353 uint32x2_t __rev1_612; __rev1_612 = __builtin_shufflevector(__s1_612, __s1_612, 1, 0); \
56354 uint32x4_t __rev2_612; __rev2_612 = __builtin_shufflevector(__s2_612, __s2_612, 3, 2, 1, 0); \
56355 __ret_612 = __rev0_612 - __noswap_vmull_u32(__rev1_612, __noswap_splat_laneq_u32(__rev2_612, __p3_612)); \
56356 __ret_612 = __builtin_shufflevector(__ret_612, __ret_612, 1, 0); \
56357 __ret_612; \
56358})
56359#endif
56360
56361#ifdef __LITTLE_ENDIAN__
56362#define vmlsl_laneq_u16(__p0_613, __p1_613, __p2_613, __p3_613) __extension__ ({ \
56363 uint32x4_t __ret_613; \
56364 uint32x4_t __s0_613 = __p0_613; \
56365 uint16x4_t __s1_613 = __p1_613; \
56366 uint16x8_t __s2_613 = __p2_613; \
56367 __ret_613 = __s0_613 - vmull_u16(__s1_613, splat_laneq_u16(__s2_613, __p3_613)); \
56368 __ret_613; \
56369})
56370#else
56371#define vmlsl_laneq_u16(__p0_614, __p1_614, __p2_614, __p3_614) __extension__ ({ \
56372 uint32x4_t __ret_614; \
56373 uint32x4_t __s0_614 = __p0_614; \
56374 uint16x4_t __s1_614 = __p1_614; \
56375 uint16x8_t __s2_614 = __p2_614; \
56376 uint32x4_t __rev0_614; __rev0_614 = __builtin_shufflevector(__s0_614, __s0_614, 3, 2, 1, 0); \
56377 uint16x4_t __rev1_614; __rev1_614 = __builtin_shufflevector(__s1_614, __s1_614, 3, 2, 1, 0); \
56378 uint16x8_t __rev2_614; __rev2_614 = __builtin_shufflevector(__s2_614, __s2_614, 7, 6, 5, 4, 3, 2, 1, 0); \
56379 __ret_614 = __rev0_614 - __noswap_vmull_u16(__rev1_614, __noswap_splat_laneq_u16(__rev2_614, __p3_614)); \
56380 __ret_614 = __builtin_shufflevector(__ret_614, __ret_614, 3, 2, 1, 0); \
56381 __ret_614; \
56382})
56383#endif
56384
56385#ifdef __LITTLE_ENDIAN__
56386#define vmlsl_laneq_s32(__p0_615, __p1_615, __p2_615, __p3_615) __extension__ ({ \
56387 int64x2_t __ret_615; \
56388 int64x2_t __s0_615 = __p0_615; \
56389 int32x2_t __s1_615 = __p1_615; \
56390 int32x4_t __s2_615 = __p2_615; \
56391 __ret_615 = __s0_615 - vmull_s32(__s1_615, splat_laneq_s32(__s2_615, __p3_615)); \
56392 __ret_615; \
56393})
56394#else
56395#define vmlsl_laneq_s32(__p0_616, __p1_616, __p2_616, __p3_616) __extension__ ({ \
56396 int64x2_t __ret_616; \
56397 int64x2_t __s0_616 = __p0_616; \
56398 int32x2_t __s1_616 = __p1_616; \
56399 int32x4_t __s2_616 = __p2_616; \
56400 int64x2_t __rev0_616; __rev0_616 = __builtin_shufflevector(__s0_616, __s0_616, 1, 0); \
56401 int32x2_t __rev1_616; __rev1_616 = __builtin_shufflevector(__s1_616, __s1_616, 1, 0); \
56402 int32x4_t __rev2_616; __rev2_616 = __builtin_shufflevector(__s2_616, __s2_616, 3, 2, 1, 0); \
56403 __ret_616 = __rev0_616 - __noswap_vmull_s32(__rev1_616, __noswap_splat_laneq_s32(__rev2_616, __p3_616)); \
56404 __ret_616 = __builtin_shufflevector(__ret_616, __ret_616, 1, 0); \
56405 __ret_616; \
56406})
56407#endif
56408
56409#ifdef __LITTLE_ENDIAN__
56410#define vmlsl_laneq_s16(__p0_617, __p1_617, __p2_617, __p3_617) __extension__ ({ \
56411 int32x4_t __ret_617; \
56412 int32x4_t __s0_617 = __p0_617; \
56413 int16x4_t __s1_617 = __p1_617; \
56414 int16x8_t __s2_617 = __p2_617; \
56415 __ret_617 = __s0_617 - vmull_s16(__s1_617, splat_laneq_s16(__s2_617, __p3_617)); \
56416 __ret_617; \
56417})
56418#else
56419#define vmlsl_laneq_s16(__p0_618, __p1_618, __p2_618, __p3_618) __extension__ ({ \
56420 int32x4_t __ret_618; \
56421 int32x4_t __s0_618 = __p0_618; \
56422 int16x4_t __s1_618 = __p1_618; \
56423 int16x8_t __s2_618 = __p2_618; \
56424 int32x4_t __rev0_618; __rev0_618 = __builtin_shufflevector(__s0_618, __s0_618, 3, 2, 1, 0); \
56425 int16x4_t __rev1_618; __rev1_618 = __builtin_shufflevector(__s1_618, __s1_618, 3, 2, 1, 0); \
56426 int16x8_t __rev2_618; __rev2_618 = __builtin_shufflevector(__s2_618, __s2_618, 7, 6, 5, 4, 3, 2, 1, 0); \
56427 __ret_618 = __rev0_618 - __noswap_vmull_s16(__rev1_618, __noswap_splat_laneq_s16(__rev2_618, __p3_618)); \
56428 __ret_618 = __builtin_shufflevector(__ret_618, __ret_618, 3, 2, 1, 0); \
56429 __ret_618; \
56430})
56431#endif
56432
56433__ai poly64x1_t vmov_n_p64(poly64_t __p0) {
56434 poly64x1_t __ret;
56435 __ret = (poly64x1_t) {__p0};
57282__ai float16x8_t vreinterpretq_f16_u8(uint8x16_t __p0) {
57283 float16x8_t __ret;
57284 __ret = (float16x8_t)(__p0);
5643657285 return __ret;
5643757286}
56438#ifdef __LITTLE_ENDIAN__
56439__ai poly64x2_t vmovq_n_p64(poly64_t __p0) {
56440 poly64x2_t __ret;
56441 __ret = (poly64x2_t) {__p0, __p0};
57287__ai float16x8_t vreinterpretq_f16_u32(uint32x4_t __p0) {
57288 float16x8_t __ret;
57289 __ret = (float16x8_t)(__p0);
5644257290 return __ret;
5644357291}
56444#else
56445__ai poly64x2_t vmovq_n_p64(poly64_t __p0) {
56446 poly64x2_t __ret;
56447 __ret = (poly64x2_t) {__p0, __p0};
56448 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
57292__ai float16x8_t vreinterpretq_f16_u64(uint64x2_t __p0) {
57293 float16x8_t __ret;
57294 __ret = (float16x8_t)(__p0);
5644957295 return __ret;
5645057296}
56451#endif
56452
56453#ifdef __LITTLE_ENDIAN__
56454__ai float64x2_t vmovq_n_f64(float64_t __p0) {
56455 float64x2_t __ret;
56456 __ret = (float64x2_t) {__p0, __p0};
57297__ai float16x8_t vreinterpretq_f16_u16(uint16x8_t __p0) {
57298 float16x8_t __ret;
57299 __ret = (float16x8_t)(__p0);
5645757300 return __ret;
5645857301}
56459#else
56460__ai float64x2_t vmovq_n_f64(float64_t __p0) {
56461 float64x2_t __ret;
56462 __ret = (float64x2_t) {__p0, __p0};
56463 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
57302__ai float16x8_t vreinterpretq_f16_s8(int8x16_t __p0) {
57303 float16x8_t __ret;
57304 __ret = (float16x8_t)(__p0);
5646457305 return __ret;
5646557306}
56466#endif
56467
56468__ai float64x1_t vmov_n_f64(float64_t __p0) {
56469 float64x1_t __ret;
56470 __ret = (float64x1_t) {__p0};
57307__ai float16x8_t vreinterpretq_f16_f64(float64x2_t __p0) {
57308 float16x8_t __ret;
57309 __ret = (float16x8_t)(__p0);
5647157310 return __ret;
5647257311}
56473#ifdef __LITTLE_ENDIAN__
56474__ai uint16x8_t vmovl_high_u8(uint8x16_t __p0_619) {
56475 uint16x8_t __ret_619;
56476 uint8x8_t __a1_619 = vget_high_u8(__p0_619);
56477 __ret_619 = (uint16x8_t)(vshll_n_u8(__a1_619, 0));
56478 return __ret_619;
57312__ai float16x8_t vreinterpretq_f16_f32(float32x4_t __p0) {
57313 float16x8_t __ret;
57314 __ret = (float16x8_t)(__p0);
57315 return __ret;
5647957316}
56480#else
56481__ai uint16x8_t vmovl_high_u8(uint8x16_t __p0_620) {
56482 uint16x8_t __ret_620;
56483 uint8x16_t __rev0_620; __rev0_620 = __builtin_shufflevector(__p0_620, __p0_620, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
56484 uint8x8_t __a1_620 = __noswap_vget_high_u8(__rev0_620);
56485 __ret_620 = (uint16x8_t)(__noswap_vshll_n_u8(__a1_620, 0));
56486 __ret_620 = __builtin_shufflevector(__ret_620, __ret_620, 7, 6, 5, 4, 3, 2, 1, 0);
56487 return __ret_620;
57317__ai float16x8_t vreinterpretq_f16_s32(int32x4_t __p0) {
57318 float16x8_t __ret;
57319 __ret = (float16x8_t)(__p0);
57320 return __ret;
5648857321}
56489__ai uint16x8_t __noswap_vmovl_high_u8(uint8x16_t __p0_621) {
56490 uint16x8_t __ret_621;
56491 uint8x8_t __a1_621 = __noswap_vget_high_u8(__p0_621);
56492 __ret_621 = (uint16x8_t)(__noswap_vshll_n_u8(__a1_621, 0));
56493 return __ret_621;
57322__ai float16x8_t vreinterpretq_f16_s64(int64x2_t __p0) {
57323 float16x8_t __ret;
57324 __ret = (float16x8_t)(__p0);
57325 return __ret;
5649457326}
56495#endif
56496
56497#ifdef __LITTLE_ENDIAN__
56498__ai uint64x2_t vmovl_high_u32(uint32x4_t __p0_622) {
56499 uint64x2_t __ret_622;
56500 uint32x2_t __a1_622 = vget_high_u32(__p0_622);
56501 __ret_622 = (uint64x2_t)(vshll_n_u32(__a1_622, 0));
56502 return __ret_622;
57327__ai float16x8_t vreinterpretq_f16_s16(int16x8_t __p0) {
57328 float16x8_t __ret;
57329 __ret = (float16x8_t)(__p0);
57330 return __ret;
5650357331}
56504#else
56505__ai uint64x2_t vmovl_high_u32(uint32x4_t __p0_623) {
56506 uint64x2_t __ret_623;
56507 uint32x4_t __rev0_623; __rev0_623 = __builtin_shufflevector(__p0_623, __p0_623, 3, 2, 1, 0);
56508 uint32x2_t __a1_623 = __noswap_vget_high_u32(__rev0_623);
56509 __ret_623 = (uint64x2_t)(__noswap_vshll_n_u32(__a1_623, 0));
56510 __ret_623 = __builtin_shufflevector(__ret_623, __ret_623, 1, 0);
56511 return __ret_623;
57332__ai int32x4_t vreinterpretq_s32_p8(poly8x16_t __p0) {
57333 int32x4_t __ret;
57334 __ret = (int32x4_t)(__p0);
57335 return __ret;
5651257336}
56513__ai uint64x2_t __noswap_vmovl_high_u32(uint32x4_t __p0_624) {
56514 uint64x2_t __ret_624;
56515 uint32x2_t __a1_624 = __noswap_vget_high_u32(__p0_624);
56516 __ret_624 = (uint64x2_t)(__noswap_vshll_n_u32(__a1_624, 0));
56517 return __ret_624;
57337__ai int32x4_t vreinterpretq_s32_p128(poly128_t __p0) {
57338 int32x4_t __ret;
57339 __ret = (int32x4_t)(__p0);
57340 return __ret;
5651857341}
56519#endif
56520
56521#ifdef __LITTLE_ENDIAN__
56522__ai uint32x4_t vmovl_high_u16(uint16x8_t __p0_625) {
56523 uint32x4_t __ret_625;
56524 uint16x4_t __a1_625 = vget_high_u16(__p0_625);
56525 __ret_625 = (uint32x4_t)(vshll_n_u16(__a1_625, 0));
56526 return __ret_625;
57342__ai int32x4_t vreinterpretq_s32_p64(poly64x2_t __p0) {
57343 int32x4_t __ret;
57344 __ret = (int32x4_t)(__p0);
57345 return __ret;
5652757346}
56528#else
56529__ai uint32x4_t vmovl_high_u16(uint16x8_t __p0_626) {
56530 uint32x4_t __ret_626;
56531 uint16x8_t __rev0_626; __rev0_626 = __builtin_shufflevector(__p0_626, __p0_626, 7, 6, 5, 4, 3, 2, 1, 0);
56532 uint16x4_t __a1_626 = __noswap_vget_high_u16(__rev0_626);
56533 __ret_626 = (uint32x4_t)(__noswap_vshll_n_u16(__a1_626, 0));
56534 __ret_626 = __builtin_shufflevector(__ret_626, __ret_626, 3, 2, 1, 0);
56535 return __ret_626;
57347__ai int32x4_t vreinterpretq_s32_p16(poly16x8_t __p0) {
57348 int32x4_t __ret;
57349 __ret = (int32x4_t)(__p0);
57350 return __ret;
5653657351}
56537__ai uint32x4_t __noswap_vmovl_high_u16(uint16x8_t __p0_627) {
56538 uint32x4_t __ret_627;
56539 uint16x4_t __a1_627 = __noswap_vget_high_u16(__p0_627);
56540 __ret_627 = (uint32x4_t)(__noswap_vshll_n_u16(__a1_627, 0));
56541 return __ret_627;
57352__ai int32x4_t vreinterpretq_s32_u8(uint8x16_t __p0) {
57353 int32x4_t __ret;
57354 __ret = (int32x4_t)(__p0);
57355 return __ret;
5654257356}
56543#endif
56544
56545#ifdef __LITTLE_ENDIAN__
56546__ai int16x8_t vmovl_high_s8(int8x16_t __p0_628) {
56547 int16x8_t __ret_628;
56548 int8x8_t __a1_628 = vget_high_s8(__p0_628);
56549 __ret_628 = (int16x8_t)(vshll_n_s8(__a1_628, 0));
56550 return __ret_628;
57357__ai int32x4_t vreinterpretq_s32_u32(uint32x4_t __p0) {
57358 int32x4_t __ret;
57359 __ret = (int32x4_t)(__p0);
57360 return __ret;
5655157361}
56552#else
56553__ai int16x8_t vmovl_high_s8(int8x16_t __p0_629) {
56554 int16x8_t __ret_629;
56555 int8x16_t __rev0_629; __rev0_629 = __builtin_shufflevector(__p0_629, __p0_629, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
56556 int8x8_t __a1_629 = __noswap_vget_high_s8(__rev0_629);
56557 __ret_629 = (int16x8_t)(__noswap_vshll_n_s8(__a1_629, 0));
56558 __ret_629 = __builtin_shufflevector(__ret_629, __ret_629, 7, 6, 5, 4, 3, 2, 1, 0);
56559 return __ret_629;
57362__ai int32x4_t vreinterpretq_s32_u64(uint64x2_t __p0) {
57363 int32x4_t __ret;
57364 __ret = (int32x4_t)(__p0);
57365 return __ret;
5656057366}
56561__ai int16x8_t __noswap_vmovl_high_s8(int8x16_t __p0_630) {
56562 int16x8_t __ret_630;
56563 int8x8_t __a1_630 = __noswap_vget_high_s8(__p0_630);
56564 __ret_630 = (int16x8_t)(__noswap_vshll_n_s8(__a1_630, 0));
56565 return __ret_630;
57367__ai int32x4_t vreinterpretq_s32_u16(uint16x8_t __p0) {
57368 int32x4_t __ret;
57369 __ret = (int32x4_t)(__p0);
57370 return __ret;
5656657371}
56567#endif
56568
56569#ifdef __LITTLE_ENDIAN__
56570__ai int64x2_t vmovl_high_s32(int32x4_t __p0_631) {
56571 int64x2_t __ret_631;
56572 int32x2_t __a1_631 = vget_high_s32(__p0_631);
56573 __ret_631 = (int64x2_t)(vshll_n_s32(__a1_631, 0));
56574 return __ret_631;
57372__ai int32x4_t vreinterpretq_s32_s8(int8x16_t __p0) {
57373 int32x4_t __ret;
57374 __ret = (int32x4_t)(__p0);
57375 return __ret;
5657557376}
56576#else
56577__ai int64x2_t vmovl_high_s32(int32x4_t __p0_632) {
56578 int64x2_t __ret_632;
56579 int32x4_t __rev0_632; __rev0_632 = __builtin_shufflevector(__p0_632, __p0_632, 3, 2, 1, 0);
56580 int32x2_t __a1_632 = __noswap_vget_high_s32(__rev0_632);
56581 __ret_632 = (int64x2_t)(__noswap_vshll_n_s32(__a1_632, 0));
56582 __ret_632 = __builtin_shufflevector(__ret_632, __ret_632, 1, 0);
56583 return __ret_632;
57377__ai int32x4_t vreinterpretq_s32_f64(float64x2_t __p0) {
57378 int32x4_t __ret;
57379 __ret = (int32x4_t)(__p0);
57380 return __ret;
5658457381}
56585__ai int64x2_t __noswap_vmovl_high_s32(int32x4_t __p0_633) {
56586 int64x2_t __ret_633;
56587 int32x2_t __a1_633 = __noswap_vget_high_s32(__p0_633);
56588 __ret_633 = (int64x2_t)(__noswap_vshll_n_s32(__a1_633, 0));
56589 return __ret_633;
57382__ai int32x4_t vreinterpretq_s32_f32(float32x4_t __p0) {
57383 int32x4_t __ret;
57384 __ret = (int32x4_t)(__p0);
57385 return __ret;
5659057386}
56591#endif
56592
56593#ifdef __LITTLE_ENDIAN__
56594__ai int32x4_t vmovl_high_s16(int16x8_t __p0_634) {
56595 int32x4_t __ret_634;
56596 int16x4_t __a1_634 = vget_high_s16(__p0_634);
56597 __ret_634 = (int32x4_t)(vshll_n_s16(__a1_634, 0));
56598 return __ret_634;
57387__ai int32x4_t vreinterpretq_s32_f16(float16x8_t __p0) {
57388 int32x4_t __ret;
57389 __ret = (int32x4_t)(__p0);
57390 return __ret;
5659957391}
56600#else
56601__ai int32x4_t vmovl_high_s16(int16x8_t __p0_635) {
56602 int32x4_t __ret_635;
56603 int16x8_t __rev0_635; __rev0_635 = __builtin_shufflevector(__p0_635, __p0_635, 7, 6, 5, 4, 3, 2, 1, 0);
56604 int16x4_t __a1_635 = __noswap_vget_high_s16(__rev0_635);
56605 __ret_635 = (int32x4_t)(__noswap_vshll_n_s16(__a1_635, 0));
56606 __ret_635 = __builtin_shufflevector(__ret_635, __ret_635, 3, 2, 1, 0);
56607 return __ret_635;
57392__ai int32x4_t vreinterpretq_s32_s64(int64x2_t __p0) {
57393 int32x4_t __ret;
57394 __ret = (int32x4_t)(__p0);
57395 return __ret;
5660857396}
56609__ai int32x4_t __noswap_vmovl_high_s16(int16x8_t __p0_636) {
56610 int32x4_t __ret_636;
56611 int16x4_t __a1_636 = __noswap_vget_high_s16(__p0_636);
56612 __ret_636 = (int32x4_t)(__noswap_vshll_n_s16(__a1_636, 0));
56613 return __ret_636;
57397__ai int32x4_t vreinterpretq_s32_s16(int16x8_t __p0) {
57398 int32x4_t __ret;
57399 __ret = (int32x4_t)(__p0);
57400 return __ret;
5661457401}
56615#endif
56616
56617#ifdef __LITTLE_ENDIAN__
56618__ai uint16x8_t vmovn_high_u32(uint16x4_t __p0, uint32x4_t __p1) {
56619 uint16x8_t __ret;
56620 __ret = vcombine_u16(__p0, vmovn_u32(__p1));
57402__ai int64x2_t vreinterpretq_s64_p8(poly8x16_t __p0) {
57403 int64x2_t __ret;
57404 __ret = (int64x2_t)(__p0);
5662157405 return __ret;
5662257406}
56623#else
56624__ai uint16x8_t vmovn_high_u32(uint16x4_t __p0, uint32x4_t __p1) {
56625 uint16x8_t __ret;
56626 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
56627 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
56628 __ret = __noswap_vcombine_u16(__rev0, __noswap_vmovn_u32(__rev1));
56629 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
57407__ai int64x2_t vreinterpretq_s64_p128(poly128_t __p0) {
57408 int64x2_t __ret;
57409 __ret = (int64x2_t)(__p0);
5663057410 return __ret;
5663157411}
56632#endif
56633
56634#ifdef __LITTLE_ENDIAN__
56635__ai uint32x4_t vmovn_high_u64(uint32x2_t __p0, uint64x2_t __p1) {
56636 uint32x4_t __ret;
56637 __ret = vcombine_u32(__p0, vmovn_u64(__p1));
57412__ai int64x2_t vreinterpretq_s64_p64(poly64x2_t __p0) {
57413 int64x2_t __ret;
57414 __ret = (int64x2_t)(__p0);
5663857415 return __ret;
5663957416}
56640#else
56641__ai uint32x4_t vmovn_high_u64(uint32x2_t __p0, uint64x2_t __p1) {
56642 uint32x4_t __ret;
56643 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
56644 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
56645 __ret = __noswap_vcombine_u32(__rev0, __noswap_vmovn_u64(__rev1));
56646 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
57417__ai int64x2_t vreinterpretq_s64_p16(poly16x8_t __p0) {
57418 int64x2_t __ret;
57419 __ret = (int64x2_t)(__p0);
5664757420 return __ret;
5664857421}
56649#endif
56650
56651#ifdef __LITTLE_ENDIAN__
56652__ai uint8x16_t vmovn_high_u16(uint8x8_t __p0, uint16x8_t __p1) {
56653 uint8x16_t __ret;
56654 __ret = vcombine_u8(__p0, vmovn_u16(__p1));
57422__ai int64x2_t vreinterpretq_s64_u8(uint8x16_t __p0) {
57423 int64x2_t __ret;
57424 __ret = (int64x2_t)(__p0);
5665557425 return __ret;
5665657426}
56657#else
56658__ai uint8x16_t vmovn_high_u16(uint8x8_t __p0, uint16x8_t __p1) {
56659 uint8x16_t __ret;
56660 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
56661 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
56662 __ret = __noswap_vcombine_u8(__rev0, __noswap_vmovn_u16(__rev1));
56663 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
57427__ai int64x2_t vreinterpretq_s64_u32(uint32x4_t __p0) {
57428 int64x2_t __ret;
57429 __ret = (int64x2_t)(__p0);
5666457430 return __ret;
5666557431}
56666#endif
56667
56668#ifdef __LITTLE_ENDIAN__
56669__ai int16x8_t vmovn_high_s32(int16x4_t __p0, int32x4_t __p1) {
57432__ai int64x2_t vreinterpretq_s64_u64(uint64x2_t __p0) {
57433 int64x2_t __ret;
57434 __ret = (int64x2_t)(__p0);
57435 return __ret;
57436}
57437__ai int64x2_t vreinterpretq_s64_u16(uint16x8_t __p0) {
57438 int64x2_t __ret;
57439 __ret = (int64x2_t)(__p0);
57440 return __ret;
57441}
57442__ai int64x2_t vreinterpretq_s64_s8(int8x16_t __p0) {
57443 int64x2_t __ret;
57444 __ret = (int64x2_t)(__p0);
57445 return __ret;
57446}
57447__ai int64x2_t vreinterpretq_s64_f64(float64x2_t __p0) {
57448 int64x2_t __ret;
57449 __ret = (int64x2_t)(__p0);
57450 return __ret;
57451}
57452__ai int64x2_t vreinterpretq_s64_f32(float32x4_t __p0) {
57453 int64x2_t __ret;
57454 __ret = (int64x2_t)(__p0);
57455 return __ret;
57456}
57457__ai int64x2_t vreinterpretq_s64_f16(float16x8_t __p0) {
57458 int64x2_t __ret;
57459 __ret = (int64x2_t)(__p0);
57460 return __ret;
57461}
57462__ai int64x2_t vreinterpretq_s64_s32(int32x4_t __p0) {
57463 int64x2_t __ret;
57464 __ret = (int64x2_t)(__p0);
57465 return __ret;
57466}
57467__ai int64x2_t vreinterpretq_s64_s16(int16x8_t __p0) {
57468 int64x2_t __ret;
57469 __ret = (int64x2_t)(__p0);
57470 return __ret;
57471}
57472__ai int16x8_t vreinterpretq_s16_p8(poly8x16_t __p0) {
5667057473 int16x8_t __ret;
56671 __ret = vcombine_s16(__p0, vmovn_s32(__p1));
57474 __ret = (int16x8_t)(__p0);
5667257475 return __ret;
5667357476}
56674#else
56675__ai int16x8_t vmovn_high_s32(int16x4_t __p0, int32x4_t __p1) {
57477__ai int16x8_t vreinterpretq_s16_p128(poly128_t __p0) {
5667657478 int16x8_t __ret;
56677 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
56678 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
56679 __ret = __noswap_vcombine_s16(__rev0, __noswap_vmovn_s32(__rev1));
56680 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
57479 __ret = (int16x8_t)(__p0);
5668157480 return __ret;
5668257481}
56683#endif
56684
56685#ifdef __LITTLE_ENDIAN__
56686__ai int32x4_t vmovn_high_s64(int32x2_t __p0, int64x2_t __p1) {
56687 int32x4_t __ret;
56688 __ret = vcombine_s32(__p0, vmovn_s64(__p1));
57482__ai int16x8_t vreinterpretq_s16_p64(poly64x2_t __p0) {
57483 int16x8_t __ret;
57484 __ret = (int16x8_t)(__p0);
5668957485 return __ret;
5669057486}
56691#else
56692__ai int32x4_t vmovn_high_s64(int32x2_t __p0, int64x2_t __p1) {
56693 int32x4_t __ret;
56694 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
56695 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
56696 __ret = __noswap_vcombine_s32(__rev0, __noswap_vmovn_s64(__rev1));
56697 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
57487__ai int16x8_t vreinterpretq_s16_p16(poly16x8_t __p0) {
57488 int16x8_t __ret;
57489 __ret = (int16x8_t)(__p0);
5669857490 return __ret;
5669957491}
56700#endif
56701
56702#ifdef __LITTLE_ENDIAN__
56703__ai int8x16_t vmovn_high_s16(int8x8_t __p0, int16x8_t __p1) {
56704 int8x16_t __ret;
56705 __ret = vcombine_s8(__p0, vmovn_s16(__p1));
57492__ai int16x8_t vreinterpretq_s16_u8(uint8x16_t __p0) {
57493 int16x8_t __ret;
57494 __ret = (int16x8_t)(__p0);
5670657495 return __ret;
5670757496}
56708#else
56709__ai int8x16_t vmovn_high_s16(int8x8_t __p0, int16x8_t __p1) {
56710 int8x16_t __ret;
56711 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
56712 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
56713 __ret = __noswap_vcombine_s8(__rev0, __noswap_vmovn_s16(__rev1));
56714 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
57497__ai int16x8_t vreinterpretq_s16_u32(uint32x4_t __p0) {
57498 int16x8_t __ret;
57499 __ret = (int16x8_t)(__p0);
5671557500 return __ret;
5671657501}
56717#endif
56718
56719#ifdef __LITTLE_ENDIAN__
56720__ai float64x2_t vmulq_f64(float64x2_t __p0, float64x2_t __p1) {
56721 float64x2_t __ret;
56722 __ret = __p0 * __p1;
57502__ai int16x8_t vreinterpretq_s16_u64(uint64x2_t __p0) {
57503 int16x8_t __ret;
57504 __ret = (int16x8_t)(__p0);
5672357505 return __ret;
5672457506}
56725#else
56726__ai float64x2_t vmulq_f64(float64x2_t __p0, float64x2_t __p1) {
56727 float64x2_t __ret;
56728 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
56729 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
56730 __ret = __rev0 * __rev1;
56731 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
57507__ai int16x8_t vreinterpretq_s16_u16(uint16x8_t __p0) {
57508 int16x8_t __ret;
57509 __ret = (int16x8_t)(__p0);
5673257510 return __ret;
5673357511}
56734#endif
56735
56736__ai float64x1_t vmul_f64(float64x1_t __p0, float64x1_t __p1) {
56737 float64x1_t __ret;
56738 __ret = __p0 * __p1;
57512__ai int16x8_t vreinterpretq_s16_s8(int8x16_t __p0) {
57513 int16x8_t __ret;
57514 __ret = (int16x8_t)(__p0);
5673957515 return __ret;
5674057516}
56741#define vmuld_lane_f64(__p0_637, __p1_637, __p2_637) __extension__ ({ \
56742 float64_t __ret_637; \
56743 float64_t __s0_637 = __p0_637; \
56744 float64x1_t __s1_637 = __p1_637; \
56745 __ret_637 = __s0_637 * vget_lane_f64(__s1_637, __p2_637); \
56746 __ret_637; \
56747})
56748#ifdef __LITTLE_ENDIAN__
56749#define vmuls_lane_f32(__p0_638, __p1_638, __p2_638) __extension__ ({ \
56750 float32_t __ret_638; \
56751 float32_t __s0_638 = __p0_638; \
56752 float32x2_t __s1_638 = __p1_638; \
56753 __ret_638 = __s0_638 * vget_lane_f32(__s1_638, __p2_638); \
56754 __ret_638; \
56755})
56756#else
56757#define vmuls_lane_f32(__p0_639, __p1_639, __p2_639) __extension__ ({ \
56758 float32_t __ret_639; \
56759 float32_t __s0_639 = __p0_639; \
56760 float32x2_t __s1_639 = __p1_639; \
56761 float32x2_t __rev1_639; __rev1_639 = __builtin_shufflevector(__s1_639, __s1_639, 1, 0); \
56762 __ret_639 = __s0_639 * __noswap_vget_lane_f32(__rev1_639, __p2_639); \
56763 __ret_639; \
56764})
56765#endif
56766
56767#define vmul_lane_f64(__p0, __p1, __p2) __extension__ ({ \
56768 float64x1_t __ret; \
56769 float64x1_t __s0 = __p0; \
56770 float64x1_t __s1 = __p1; \
56771 __ret = (float64x1_t) __builtin_neon_vmul_lane_v((int8x8_t)__s0, (int8x8_t)__s1, __p2, 10); \
56772 __ret; \
56773})
56774#ifdef __LITTLE_ENDIAN__
56775#define vmulq_lane_f64(__p0_640, __p1_640, __p2_640) __extension__ ({ \
56776 float64x2_t __ret_640; \
56777 float64x2_t __s0_640 = __p0_640; \
56778 float64x1_t __s1_640 = __p1_640; \
56779 __ret_640 = __s0_640 * splatq_lane_f64(__s1_640, __p2_640); \
56780 __ret_640; \
56781})
56782#else
56783#define vmulq_lane_f64(__p0_641, __p1_641, __p2_641) __extension__ ({ \
56784 float64x2_t __ret_641; \
56785 float64x2_t __s0_641 = __p0_641; \
56786 float64x1_t __s1_641 = __p1_641; \
56787 float64x2_t __rev0_641; __rev0_641 = __builtin_shufflevector(__s0_641, __s0_641, 1, 0); \
56788 __ret_641 = __rev0_641 * __noswap_splatq_lane_f64(__s1_641, __p2_641); \
56789 __ret_641 = __builtin_shufflevector(__ret_641, __ret_641, 1, 0); \
56790 __ret_641; \
56791})
56792#endif
56793
56794#ifdef __LITTLE_ENDIAN__
56795#define vmuld_laneq_f64(__p0_642, __p1_642, __p2_642) __extension__ ({ \
56796 float64_t __ret_642; \
56797 float64_t __s0_642 = __p0_642; \
56798 float64x2_t __s1_642 = __p1_642; \
56799 __ret_642 = __s0_642 * vgetq_lane_f64(__s1_642, __p2_642); \
56800 __ret_642; \
56801})
56802#else
56803#define vmuld_laneq_f64(__p0_643, __p1_643, __p2_643) __extension__ ({ \
56804 float64_t __ret_643; \
56805 float64_t __s0_643 = __p0_643; \
56806 float64x2_t __s1_643 = __p1_643; \
56807 float64x2_t __rev1_643; __rev1_643 = __builtin_shufflevector(__s1_643, __s1_643, 1, 0); \
56808 __ret_643 = __s0_643 * __noswap_vgetq_lane_f64(__rev1_643, __p2_643); \
56809 __ret_643; \
56810})
56811#endif
56812
56813#ifdef __LITTLE_ENDIAN__
56814#define vmuls_laneq_f32(__p0_644, __p1_644, __p2_644) __extension__ ({ \
56815 float32_t __ret_644; \
56816 float32_t __s0_644 = __p0_644; \
56817 float32x4_t __s1_644 = __p1_644; \
56818 __ret_644 = __s0_644 * vgetq_lane_f32(__s1_644, __p2_644); \
56819 __ret_644; \
56820})
56821#else
56822#define vmuls_laneq_f32(__p0_645, __p1_645, __p2_645) __extension__ ({ \
56823 float32_t __ret_645; \
56824 float32_t __s0_645 = __p0_645; \
56825 float32x4_t __s1_645 = __p1_645; \
56826 float32x4_t __rev1_645; __rev1_645 = __builtin_shufflevector(__s1_645, __s1_645, 3, 2, 1, 0); \
56827 __ret_645 = __s0_645 * __noswap_vgetq_lane_f32(__rev1_645, __p2_645); \
56828 __ret_645; \
56829})
56830#endif
56831
56832#ifdef __LITTLE_ENDIAN__
56833#define vmul_laneq_f64(__p0, __p1, __p2) __extension__ ({ \
56834 float64x1_t __ret; \
56835 float64x1_t __s0 = __p0; \
56836 float64x2_t __s1 = __p1; \
56837 __ret = (float64x1_t) __builtin_neon_vmul_laneq_v((int8x8_t)__s0, (int8x16_t)__s1, __p2, 10); \
56838 __ret; \
56839})
56840#else
56841#define vmul_laneq_f64(__p0, __p1, __p2) __extension__ ({ \
56842 float64x1_t __ret; \
56843 float64x1_t __s0 = __p0; \
56844 float64x2_t __s1 = __p1; \
56845 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
56846 __ret = (float64x1_t) __builtin_neon_vmul_laneq_v((int8x8_t)__s0, (int8x16_t)__rev1, __p2, 10); \
56847 __ret; \
56848})
56849#endif
56850
56851#ifdef __LITTLE_ENDIAN__
56852#define vmulq_laneq_u32(__p0_646, __p1_646, __p2_646) __extension__ ({ \
56853 uint32x4_t __ret_646; \
56854 uint32x4_t __s0_646 = __p0_646; \
56855 uint32x4_t __s1_646 = __p1_646; \
56856 __ret_646 = __s0_646 * splatq_laneq_u32(__s1_646, __p2_646); \
56857 __ret_646; \
56858})
56859#else
56860#define vmulq_laneq_u32(__p0_647, __p1_647, __p2_647) __extension__ ({ \
56861 uint32x4_t __ret_647; \
56862 uint32x4_t __s0_647 = __p0_647; \
56863 uint32x4_t __s1_647 = __p1_647; \
56864 uint32x4_t __rev0_647; __rev0_647 = __builtin_shufflevector(__s0_647, __s0_647, 3, 2, 1, 0); \
56865 uint32x4_t __rev1_647; __rev1_647 = __builtin_shufflevector(__s1_647, __s1_647, 3, 2, 1, 0); \
56866 __ret_647 = __rev0_647 * __noswap_splatq_laneq_u32(__rev1_647, __p2_647); \
56867 __ret_647 = __builtin_shufflevector(__ret_647, __ret_647, 3, 2, 1, 0); \
56868 __ret_647; \
56869})
56870#endif
56871
56872#ifdef __LITTLE_ENDIAN__
56873#define vmulq_laneq_u16(__p0_648, __p1_648, __p2_648) __extension__ ({ \
56874 uint16x8_t __ret_648; \
56875 uint16x8_t __s0_648 = __p0_648; \
56876 uint16x8_t __s1_648 = __p1_648; \
56877 __ret_648 = __s0_648 * splatq_laneq_u16(__s1_648, __p2_648); \
56878 __ret_648; \
56879})
56880#else
56881#define vmulq_laneq_u16(__p0_649, __p1_649, __p2_649) __extension__ ({ \
56882 uint16x8_t __ret_649; \
56883 uint16x8_t __s0_649 = __p0_649; \
56884 uint16x8_t __s1_649 = __p1_649; \
56885 uint16x8_t __rev0_649; __rev0_649 = __builtin_shufflevector(__s0_649, __s0_649, 7, 6, 5, 4, 3, 2, 1, 0); \
56886 uint16x8_t __rev1_649; __rev1_649 = __builtin_shufflevector(__s1_649, __s1_649, 7, 6, 5, 4, 3, 2, 1, 0); \
56887 __ret_649 = __rev0_649 * __noswap_splatq_laneq_u16(__rev1_649, __p2_649); \
56888 __ret_649 = __builtin_shufflevector(__ret_649, __ret_649, 7, 6, 5, 4, 3, 2, 1, 0); \
56889 __ret_649; \
56890})
56891#endif
56892
56893#ifdef __LITTLE_ENDIAN__
56894#define vmulq_laneq_f64(__p0_650, __p1_650, __p2_650) __extension__ ({ \
56895 float64x2_t __ret_650; \
56896 float64x2_t __s0_650 = __p0_650; \
56897 float64x2_t __s1_650 = __p1_650; \
56898 __ret_650 = __s0_650 * splatq_laneq_f64(__s1_650, __p2_650); \
56899 __ret_650; \
56900})
56901#else
56902#define vmulq_laneq_f64(__p0_651, __p1_651, __p2_651) __extension__ ({ \
56903 float64x2_t __ret_651; \
56904 float64x2_t __s0_651 = __p0_651; \
56905 float64x2_t __s1_651 = __p1_651; \
56906 float64x2_t __rev0_651; __rev0_651 = __builtin_shufflevector(__s0_651, __s0_651, 1, 0); \
56907 float64x2_t __rev1_651; __rev1_651 = __builtin_shufflevector(__s1_651, __s1_651, 1, 0); \
56908 __ret_651 = __rev0_651 * __noswap_splatq_laneq_f64(__rev1_651, __p2_651); \
56909 __ret_651 = __builtin_shufflevector(__ret_651, __ret_651, 1, 0); \
56910 __ret_651; \
56911})
56912#endif
56913
56914#ifdef __LITTLE_ENDIAN__
56915#define vmulq_laneq_f32(__p0_652, __p1_652, __p2_652) __extension__ ({ \
56916 float32x4_t __ret_652; \
56917 float32x4_t __s0_652 = __p0_652; \
56918 float32x4_t __s1_652 = __p1_652; \
56919 __ret_652 = __s0_652 * splatq_laneq_f32(__s1_652, __p2_652); \
56920 __ret_652; \
56921})
56922#else
56923#define vmulq_laneq_f32(__p0_653, __p1_653, __p2_653) __extension__ ({ \
56924 float32x4_t __ret_653; \
56925 float32x4_t __s0_653 = __p0_653; \
56926 float32x4_t __s1_653 = __p1_653; \
56927 float32x4_t __rev0_653; __rev0_653 = __builtin_shufflevector(__s0_653, __s0_653, 3, 2, 1, 0); \
56928 float32x4_t __rev1_653; __rev1_653 = __builtin_shufflevector(__s1_653, __s1_653, 3, 2, 1, 0); \
56929 __ret_653 = __rev0_653 * __noswap_splatq_laneq_f32(__rev1_653, __p2_653); \
56930 __ret_653 = __builtin_shufflevector(__ret_653, __ret_653, 3, 2, 1, 0); \
56931 __ret_653; \
56932})
56933#endif
56934
56935#ifdef __LITTLE_ENDIAN__
56936#define vmulq_laneq_s32(__p0_654, __p1_654, __p2_654) __extension__ ({ \
56937 int32x4_t __ret_654; \
56938 int32x4_t __s0_654 = __p0_654; \
56939 int32x4_t __s1_654 = __p1_654; \
56940 __ret_654 = __s0_654 * splatq_laneq_s32(__s1_654, __p2_654); \
56941 __ret_654; \
56942})
56943#else
56944#define vmulq_laneq_s32(__p0_655, __p1_655, __p2_655) __extension__ ({ \
56945 int32x4_t __ret_655; \
56946 int32x4_t __s0_655 = __p0_655; \
56947 int32x4_t __s1_655 = __p1_655; \
56948 int32x4_t __rev0_655; __rev0_655 = __builtin_shufflevector(__s0_655, __s0_655, 3, 2, 1, 0); \
56949 int32x4_t __rev1_655; __rev1_655 = __builtin_shufflevector(__s1_655, __s1_655, 3, 2, 1, 0); \
56950 __ret_655 = __rev0_655 * __noswap_splatq_laneq_s32(__rev1_655, __p2_655); \
56951 __ret_655 = __builtin_shufflevector(__ret_655, __ret_655, 3, 2, 1, 0); \
56952 __ret_655; \
56953})
56954#endif
56955
56956#ifdef __LITTLE_ENDIAN__
56957#define vmulq_laneq_s16(__p0_656, __p1_656, __p2_656) __extension__ ({ \
56958 int16x8_t __ret_656; \
56959 int16x8_t __s0_656 = __p0_656; \
56960 int16x8_t __s1_656 = __p1_656; \
56961 __ret_656 = __s0_656 * splatq_laneq_s16(__s1_656, __p2_656); \
56962 __ret_656; \
56963})
56964#else
56965#define vmulq_laneq_s16(__p0_657, __p1_657, __p2_657) __extension__ ({ \
56966 int16x8_t __ret_657; \
56967 int16x8_t __s0_657 = __p0_657; \
56968 int16x8_t __s1_657 = __p1_657; \
56969 int16x8_t __rev0_657; __rev0_657 = __builtin_shufflevector(__s0_657, __s0_657, 7, 6, 5, 4, 3, 2, 1, 0); \
56970 int16x8_t __rev1_657; __rev1_657 = __builtin_shufflevector(__s1_657, __s1_657, 7, 6, 5, 4, 3, 2, 1, 0); \
56971 __ret_657 = __rev0_657 * __noswap_splatq_laneq_s16(__rev1_657, __p2_657); \
56972 __ret_657 = __builtin_shufflevector(__ret_657, __ret_657, 7, 6, 5, 4, 3, 2, 1, 0); \
56973 __ret_657; \
56974})
56975#endif
56976
56977#ifdef __LITTLE_ENDIAN__
56978#define vmul_laneq_u32(__p0_658, __p1_658, __p2_658) __extension__ ({ \
56979 uint32x2_t __ret_658; \
56980 uint32x2_t __s0_658 = __p0_658; \
56981 uint32x4_t __s1_658 = __p1_658; \
56982 __ret_658 = __s0_658 * splat_laneq_u32(__s1_658, __p2_658); \
56983 __ret_658; \
56984})
56985#else
56986#define vmul_laneq_u32(__p0_659, __p1_659, __p2_659) __extension__ ({ \
56987 uint32x2_t __ret_659; \
56988 uint32x2_t __s0_659 = __p0_659; \
56989 uint32x4_t __s1_659 = __p1_659; \
56990 uint32x2_t __rev0_659; __rev0_659 = __builtin_shufflevector(__s0_659, __s0_659, 1, 0); \
56991 uint32x4_t __rev1_659; __rev1_659 = __builtin_shufflevector(__s1_659, __s1_659, 3, 2, 1, 0); \
56992 __ret_659 = __rev0_659 * __noswap_splat_laneq_u32(__rev1_659, __p2_659); \
56993 __ret_659 = __builtin_shufflevector(__ret_659, __ret_659, 1, 0); \
56994 __ret_659; \
56995})
56996#endif
56997
56998#ifdef __LITTLE_ENDIAN__
56999#define vmul_laneq_u16(__p0_660, __p1_660, __p2_660) __extension__ ({ \
57000 uint16x4_t __ret_660; \
57001 uint16x4_t __s0_660 = __p0_660; \
57002 uint16x8_t __s1_660 = __p1_660; \
57003 __ret_660 = __s0_660 * splat_laneq_u16(__s1_660, __p2_660); \
57004 __ret_660; \
57005})
57006#else
57007#define vmul_laneq_u16(__p0_661, __p1_661, __p2_661) __extension__ ({ \
57008 uint16x4_t __ret_661; \
57009 uint16x4_t __s0_661 = __p0_661; \
57010 uint16x8_t __s1_661 = __p1_661; \
57011 uint16x4_t __rev0_661; __rev0_661 = __builtin_shufflevector(__s0_661, __s0_661, 3, 2, 1, 0); \
57012 uint16x8_t __rev1_661; __rev1_661 = __builtin_shufflevector(__s1_661, __s1_661, 7, 6, 5, 4, 3, 2, 1, 0); \
57013 __ret_661 = __rev0_661 * __noswap_splat_laneq_u16(__rev1_661, __p2_661); \
57014 __ret_661 = __builtin_shufflevector(__ret_661, __ret_661, 3, 2, 1, 0); \
57015 __ret_661; \
57016})
57017#endif
57018
57019#ifdef __LITTLE_ENDIAN__
57020#define vmul_laneq_f32(__p0_662, __p1_662, __p2_662) __extension__ ({ \
57021 float32x2_t __ret_662; \
57022 float32x2_t __s0_662 = __p0_662; \
57023 float32x4_t __s1_662 = __p1_662; \
57024 __ret_662 = __s0_662 * splat_laneq_f32(__s1_662, __p2_662); \
57025 __ret_662; \
57026})
57027#else
57028#define vmul_laneq_f32(__p0_663, __p1_663, __p2_663) __extension__ ({ \
57029 float32x2_t __ret_663; \
57030 float32x2_t __s0_663 = __p0_663; \
57031 float32x4_t __s1_663 = __p1_663; \
57032 float32x2_t __rev0_663; __rev0_663 = __builtin_shufflevector(__s0_663, __s0_663, 1, 0); \
57033 float32x4_t __rev1_663; __rev1_663 = __builtin_shufflevector(__s1_663, __s1_663, 3, 2, 1, 0); \
57034 __ret_663 = __rev0_663 * __noswap_splat_laneq_f32(__rev1_663, __p2_663); \
57035 __ret_663 = __builtin_shufflevector(__ret_663, __ret_663, 1, 0); \
57036 __ret_663; \
57037})
57038#endif
57039
57040#ifdef __LITTLE_ENDIAN__
57041#define vmul_laneq_s32(__p0_664, __p1_664, __p2_664) __extension__ ({ \
57042 int32x2_t __ret_664; \
57043 int32x2_t __s0_664 = __p0_664; \
57044 int32x4_t __s1_664 = __p1_664; \
57045 __ret_664 = __s0_664 * splat_laneq_s32(__s1_664, __p2_664); \
57046 __ret_664; \
57047})
57048#else
57049#define vmul_laneq_s32(__p0_665, __p1_665, __p2_665) __extension__ ({ \
57050 int32x2_t __ret_665; \
57051 int32x2_t __s0_665 = __p0_665; \
57052 int32x4_t __s1_665 = __p1_665; \
57053 int32x2_t __rev0_665; __rev0_665 = __builtin_shufflevector(__s0_665, __s0_665, 1, 0); \
57054 int32x4_t __rev1_665; __rev1_665 = __builtin_shufflevector(__s1_665, __s1_665, 3, 2, 1, 0); \
57055 __ret_665 = __rev0_665 * __noswap_splat_laneq_s32(__rev1_665, __p2_665); \
57056 __ret_665 = __builtin_shufflevector(__ret_665, __ret_665, 1, 0); \
57057 __ret_665; \
57058})
57059#endif
57060
57061#ifdef __LITTLE_ENDIAN__
57062#define vmul_laneq_s16(__p0_666, __p1_666, __p2_666) __extension__ ({ \
57063 int16x4_t __ret_666; \
57064 int16x4_t __s0_666 = __p0_666; \
57065 int16x8_t __s1_666 = __p1_666; \
57066 __ret_666 = __s0_666 * splat_laneq_s16(__s1_666, __p2_666); \
57067 __ret_666; \
57068})
57069#else
57070#define vmul_laneq_s16(__p0_667, __p1_667, __p2_667) __extension__ ({ \
57071 int16x4_t __ret_667; \
57072 int16x4_t __s0_667 = __p0_667; \
57073 int16x8_t __s1_667 = __p1_667; \
57074 int16x4_t __rev0_667; __rev0_667 = __builtin_shufflevector(__s0_667, __s0_667, 3, 2, 1, 0); \
57075 int16x8_t __rev1_667; __rev1_667 = __builtin_shufflevector(__s1_667, __s1_667, 7, 6, 5, 4, 3, 2, 1, 0); \
57076 __ret_667 = __rev0_667 * __noswap_splat_laneq_s16(__rev1_667, __p2_667); \
57077 __ret_667 = __builtin_shufflevector(__ret_667, __ret_667, 3, 2, 1, 0); \
57078 __ret_667; \
57079})
57080#endif
57081
57082__ai float64x1_t vmul_n_f64(float64x1_t __p0, float64_t __p1) {
57083 float64x1_t __ret;
57084 __ret = (float64x1_t) __builtin_neon_vmul_n_f64((float64x1_t)__p0, __p1);
57517__ai int16x8_t vreinterpretq_s16_f64(float64x2_t __p0) {
57518 int16x8_t __ret;
57519 __ret = (int16x8_t)(__p0);
57520 return __ret;
57521}
57522__ai int16x8_t vreinterpretq_s16_f32(float32x4_t __p0) {
57523 int16x8_t __ret;
57524 __ret = (int16x8_t)(__p0);
57525 return __ret;
57526}
57527__ai int16x8_t vreinterpretq_s16_f16(float16x8_t __p0) {
57528 int16x8_t __ret;
57529 __ret = (int16x8_t)(__p0);
57530 return __ret;
57531}
57532__ai int16x8_t vreinterpretq_s16_s32(int32x4_t __p0) {
57533 int16x8_t __ret;
57534 __ret = (int16x8_t)(__p0);
57535 return __ret;
57536}
57537__ai int16x8_t vreinterpretq_s16_s64(int64x2_t __p0) {
57538 int16x8_t __ret;
57539 __ret = (int16x8_t)(__p0);
57540 return __ret;
57541}
57542__ai uint8x8_t vreinterpret_u8_p8(poly8x8_t __p0) {
57543 uint8x8_t __ret;
57544 __ret = (uint8x8_t)(__p0);
57545 return __ret;
57546}
57547__ai uint8x8_t vreinterpret_u8_p64(poly64x1_t __p0) {
57548 uint8x8_t __ret;
57549 __ret = (uint8x8_t)(__p0);
57550 return __ret;
57551}
57552__ai uint8x8_t vreinterpret_u8_p16(poly16x4_t __p0) {
57553 uint8x8_t __ret;
57554 __ret = (uint8x8_t)(__p0);
57555 return __ret;
57556}
57557__ai uint8x8_t vreinterpret_u8_u32(uint32x2_t __p0) {
57558 uint8x8_t __ret;
57559 __ret = (uint8x8_t)(__p0);
5708557560 return __ret;
5708657561}
57087#ifdef __LITTLE_ENDIAN__
57088__ai float64x2_t vmulq_n_f64(float64x2_t __p0, float64_t __p1) {
57089 float64x2_t __ret;
57090 __ret = __p0 * (float64x2_t) {__p1, __p1};
57562__ai uint8x8_t vreinterpret_u8_u64(uint64x1_t __p0) {
57563 uint8x8_t __ret;
57564 __ret = (uint8x8_t)(__p0);
5709157565 return __ret;
5709257566}
57093#else
57094__ai float64x2_t vmulq_n_f64(float64x2_t __p0, float64_t __p1) {
57095 float64x2_t __ret;
57096 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
57097 __ret = __rev0 * (float64x2_t) {__p1, __p1};
57098 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
57567__ai uint8x8_t vreinterpret_u8_u16(uint16x4_t __p0) {
57568 uint8x8_t __ret;
57569 __ret = (uint8x8_t)(__p0);
5709957570 return __ret;
5710057571}
57101#endif
57102
57103__ai poly128_t vmull_p64(poly64_t __p0, poly64_t __p1) {
57104 poly128_t __ret;
57105 __ret = (poly128_t) __builtin_neon_vmull_p64(__p0, __p1);
57572__ai uint8x8_t vreinterpret_u8_s8(int8x8_t __p0) {
57573 uint8x8_t __ret;
57574 __ret = (uint8x8_t)(__p0);
5710657575 return __ret;
5710757576}
57108#ifdef __LITTLE_ENDIAN__
57109__ai poly16x8_t vmull_high_p8(poly8x16_t __p0, poly8x16_t __p1) {
57110 poly16x8_t __ret;
57111 __ret = vmull_p8(vget_high_p8(__p0), vget_high_p8(__p1));
57577__ai uint8x8_t vreinterpret_u8_f64(float64x1_t __p0) {
57578 uint8x8_t __ret;
57579 __ret = (uint8x8_t)(__p0);
5711257580 return __ret;
5711357581}
57114#else
57115__ai poly16x8_t vmull_high_p8(poly8x16_t __p0, poly8x16_t __p1) {
57116 poly16x8_t __ret;
57117 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
57118 poly8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
57119 __ret = __noswap_vmull_p8(__noswap_vget_high_p8(__rev0), __noswap_vget_high_p8(__rev1));
57120 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
57582__ai uint8x8_t vreinterpret_u8_f32(float32x2_t __p0) {
57583 uint8x8_t __ret;
57584 __ret = (uint8x8_t)(__p0);
5712157585 return __ret;
5712257586}
57123#endif
57124
57125#ifdef __LITTLE_ENDIAN__
57126__ai uint16x8_t vmull_high_u8(uint8x16_t __p0, uint8x16_t __p1) {
57127 uint16x8_t __ret;
57128 __ret = vmull_u8(vget_high_u8(__p0), vget_high_u8(__p1));
57587__ai uint8x8_t vreinterpret_u8_f16(float16x4_t __p0) {
57588 uint8x8_t __ret;
57589 __ret = (uint8x8_t)(__p0);
5712957590 return __ret;
5713057591}
57131#else
57132__ai uint16x8_t vmull_high_u8(uint8x16_t __p0, uint8x16_t __p1) {
57133 uint16x8_t __ret;
57134 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
57135 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
57136 __ret = __noswap_vmull_u8(__noswap_vget_high_u8(__rev0), __noswap_vget_high_u8(__rev1));
57137 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
57592__ai uint8x8_t vreinterpret_u8_s32(int32x2_t __p0) {
57593 uint8x8_t __ret;
57594 __ret = (uint8x8_t)(__p0);
5713857595 return __ret;
5713957596}
57140#endif
57141
57142#ifdef __LITTLE_ENDIAN__
57143__ai uint64x2_t vmull_high_u32(uint32x4_t __p0, uint32x4_t __p1) {
57144 uint64x2_t __ret;
57145 __ret = vmull_u32(vget_high_u32(__p0), vget_high_u32(__p1));
57597__ai uint8x8_t vreinterpret_u8_s64(int64x1_t __p0) {
57598 uint8x8_t __ret;
57599 __ret = (uint8x8_t)(__p0);
5714657600 return __ret;
5714757601}
57148#else
57149__ai uint64x2_t vmull_high_u32(uint32x4_t __p0, uint32x4_t __p1) {
57150 uint64x2_t __ret;
57151 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
57152 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
57153 __ret = __noswap_vmull_u32(__noswap_vget_high_u32(__rev0), __noswap_vget_high_u32(__rev1));
57154 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
57602__ai uint8x8_t vreinterpret_u8_s16(int16x4_t __p0) {
57603 uint8x8_t __ret;
57604 __ret = (uint8x8_t)(__p0);
5715557605 return __ret;
5715657606}
57157#endif
57158
57159#ifdef __LITTLE_ENDIAN__
57160__ai uint32x4_t vmull_high_u16(uint16x8_t __p0, uint16x8_t __p1) {
57161 uint32x4_t __ret;
57162 __ret = vmull_u16(vget_high_u16(__p0), vget_high_u16(__p1));
57607__ai uint32x2_t vreinterpret_u32_p8(poly8x8_t __p0) {
57608 uint32x2_t __ret;
57609 __ret = (uint32x2_t)(__p0);
5716357610 return __ret;
5716457611}
57165#else
57166__ai uint32x4_t vmull_high_u16(uint16x8_t __p0, uint16x8_t __p1) {
57167 uint32x4_t __ret;
57168 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
57169 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
57170 __ret = __noswap_vmull_u16(__noswap_vget_high_u16(__rev0), __noswap_vget_high_u16(__rev1));
57171 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
57612__ai uint32x2_t vreinterpret_u32_p64(poly64x1_t __p0) {
57613 uint32x2_t __ret;
57614 __ret = (uint32x2_t)(__p0);
5717257615 return __ret;
5717357616}
57174#endif
57175
57176#ifdef __LITTLE_ENDIAN__
57177__ai int16x8_t vmull_high_s8(int8x16_t __p0, int8x16_t __p1) {
57178 int16x8_t __ret;
57179 __ret = vmull_s8(vget_high_s8(__p0), vget_high_s8(__p1));
57617__ai uint32x2_t vreinterpret_u32_p16(poly16x4_t __p0) {
57618 uint32x2_t __ret;
57619 __ret = (uint32x2_t)(__p0);
5718057620 return __ret;
5718157621}
57182#else
57183__ai int16x8_t vmull_high_s8(int8x16_t __p0, int8x16_t __p1) {
57184 int16x8_t __ret;
57185 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
57186 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
57187 __ret = __noswap_vmull_s8(__noswap_vget_high_s8(__rev0), __noswap_vget_high_s8(__rev1));
57188 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
57622__ai uint32x2_t vreinterpret_u32_u8(uint8x8_t __p0) {
57623 uint32x2_t __ret;
57624 __ret = (uint32x2_t)(__p0);
5718957625 return __ret;
5719057626}
57191#endif
57192
57193#ifdef __LITTLE_ENDIAN__
57194__ai int64x2_t vmull_high_s32(int32x4_t __p0, int32x4_t __p1) {
57195 int64x2_t __ret;
57196 __ret = vmull_s32(vget_high_s32(__p0), vget_high_s32(__p1));
57627__ai uint32x2_t vreinterpret_u32_u64(uint64x1_t __p0) {
57628 uint32x2_t __ret;
57629 __ret = (uint32x2_t)(__p0);
5719757630 return __ret;
5719857631}
57199#else
57200__ai int64x2_t vmull_high_s32(int32x4_t __p0, int32x4_t __p1) {
57201 int64x2_t __ret;
57202 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
57203 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
57204 __ret = __noswap_vmull_s32(__noswap_vget_high_s32(__rev0), __noswap_vget_high_s32(__rev1));
57205 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
57632__ai uint32x2_t vreinterpret_u32_u16(uint16x4_t __p0) {
57633 uint32x2_t __ret;
57634 __ret = (uint32x2_t)(__p0);
5720657635 return __ret;
5720757636}
57208#endif
57209
57210#ifdef __LITTLE_ENDIAN__
57211__ai int32x4_t vmull_high_s16(int16x8_t __p0, int16x8_t __p1) {
57212 int32x4_t __ret;
57213 __ret = vmull_s16(vget_high_s16(__p0), vget_high_s16(__p1));
57637__ai uint32x2_t vreinterpret_u32_s8(int8x8_t __p0) {
57638 uint32x2_t __ret;
57639 __ret = (uint32x2_t)(__p0);
5721457640 return __ret;
5721557641}
57216#else
57217__ai int32x4_t vmull_high_s16(int16x8_t __p0, int16x8_t __p1) {
57218 int32x4_t __ret;
57219 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
57220 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
57221 __ret = __noswap_vmull_s16(__noswap_vget_high_s16(__rev0), __noswap_vget_high_s16(__rev1));
57222 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
57642__ai uint32x2_t vreinterpret_u32_f64(float64x1_t __p0) {
57643 uint32x2_t __ret;
57644 __ret = (uint32x2_t)(__p0);
5722357645 return __ret;
5722457646}
57225#endif
57226
57227#ifdef __LITTLE_ENDIAN__
57228__ai poly128_t vmull_high_p64(poly64x2_t __p0, poly64x2_t __p1) {
57229 poly128_t __ret;
57230 __ret = vmull_p64((poly64_t)(vget_high_p64(__p0)), (poly64_t)(vget_high_p64(__p1)));
57647__ai uint32x2_t vreinterpret_u32_f32(float32x2_t __p0) {
57648 uint32x2_t __ret;
57649 __ret = (uint32x2_t)(__p0);
5723157650 return __ret;
5723257651}
57233#else
57234__ai poly128_t vmull_high_p64(poly64x2_t __p0, poly64x2_t __p1) {
57235 poly128_t __ret;
57236 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
57237 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
57238 __ret = vmull_p64((poly64_t)(__noswap_vget_high_p64(__rev0)), (poly64_t)(__noswap_vget_high_p64(__rev1)));
57652__ai uint32x2_t vreinterpret_u32_f16(float16x4_t __p0) {
57653 uint32x2_t __ret;
57654 __ret = (uint32x2_t)(__p0);
5723957655 return __ret;
5724057656}
57241#endif
57242
57243#ifdef __LITTLE_ENDIAN__
57244#define vmull_high_lane_u32(__p0_668, __p1_668, __p2_668) __extension__ ({ \
57245 uint64x2_t __ret_668; \
57246 uint32x4_t __s0_668 = __p0_668; \
57247 uint32x2_t __s1_668 = __p1_668; \
57248 __ret_668 = vmull_u32(vget_high_u32(__s0_668), splat_lane_u32(__s1_668, __p2_668)); \
57249 __ret_668; \
57250})
57251#else
57252#define vmull_high_lane_u32(__p0_669, __p1_669, __p2_669) __extension__ ({ \
57253 uint64x2_t __ret_669; \
57254 uint32x4_t __s0_669 = __p0_669; \
57255 uint32x2_t __s1_669 = __p1_669; \
57256 uint32x4_t __rev0_669; __rev0_669 = __builtin_shufflevector(__s0_669, __s0_669, 3, 2, 1, 0); \
57257 uint32x2_t __rev1_669; __rev1_669 = __builtin_shufflevector(__s1_669, __s1_669, 1, 0); \
57258 __ret_669 = __noswap_vmull_u32(__noswap_vget_high_u32(__rev0_669), __noswap_splat_lane_u32(__rev1_669, __p2_669)); \
57259 __ret_669 = __builtin_shufflevector(__ret_669, __ret_669, 1, 0); \
57260 __ret_669; \
57261})
57262#endif
57263
57264#ifdef __LITTLE_ENDIAN__
57265#define vmull_high_lane_u16(__p0_670, __p1_670, __p2_670) __extension__ ({ \
57266 uint32x4_t __ret_670; \
57267 uint16x8_t __s0_670 = __p0_670; \
57268 uint16x4_t __s1_670 = __p1_670; \
57269 __ret_670 = vmull_u16(vget_high_u16(__s0_670), splat_lane_u16(__s1_670, __p2_670)); \
57270 __ret_670; \
57271})
57272#else
57273#define vmull_high_lane_u16(__p0_671, __p1_671, __p2_671) __extension__ ({ \
57274 uint32x4_t __ret_671; \
57275 uint16x8_t __s0_671 = __p0_671; \
57276 uint16x4_t __s1_671 = __p1_671; \
57277 uint16x8_t __rev0_671; __rev0_671 = __builtin_shufflevector(__s0_671, __s0_671, 7, 6, 5, 4, 3, 2, 1, 0); \
57278 uint16x4_t __rev1_671; __rev1_671 = __builtin_shufflevector(__s1_671, __s1_671, 3, 2, 1, 0); \
57279 __ret_671 = __noswap_vmull_u16(__noswap_vget_high_u16(__rev0_671), __noswap_splat_lane_u16(__rev1_671, __p2_671)); \
57280 __ret_671 = __builtin_shufflevector(__ret_671, __ret_671, 3, 2, 1, 0); \
57281 __ret_671; \
57282})
57283#endif
57284
57285#ifdef __LITTLE_ENDIAN__
57286#define vmull_high_lane_s32(__p0_672, __p1_672, __p2_672) __extension__ ({ \
57287 int64x2_t __ret_672; \
57288 int32x4_t __s0_672 = __p0_672; \
57289 int32x2_t __s1_672 = __p1_672; \
57290 __ret_672 = vmull_s32(vget_high_s32(__s0_672), splat_lane_s32(__s1_672, __p2_672)); \
57291 __ret_672; \
57292})
57293#else
57294#define vmull_high_lane_s32(__p0_673, __p1_673, __p2_673) __extension__ ({ \
57295 int64x2_t __ret_673; \
57296 int32x4_t __s0_673 = __p0_673; \
57297 int32x2_t __s1_673 = __p1_673; \
57298 int32x4_t __rev0_673; __rev0_673 = __builtin_shufflevector(__s0_673, __s0_673, 3, 2, 1, 0); \
57299 int32x2_t __rev1_673; __rev1_673 = __builtin_shufflevector(__s1_673, __s1_673, 1, 0); \
57300 __ret_673 = __noswap_vmull_s32(__noswap_vget_high_s32(__rev0_673), __noswap_splat_lane_s32(__rev1_673, __p2_673)); \
57301 __ret_673 = __builtin_shufflevector(__ret_673, __ret_673, 1, 0); \
57302 __ret_673; \
57303})
57304#endif
57305
57306#ifdef __LITTLE_ENDIAN__
57307#define vmull_high_lane_s16(__p0_674, __p1_674, __p2_674) __extension__ ({ \
57308 int32x4_t __ret_674; \
57309 int16x8_t __s0_674 = __p0_674; \
57310 int16x4_t __s1_674 = __p1_674; \
57311 __ret_674 = vmull_s16(vget_high_s16(__s0_674), splat_lane_s16(__s1_674, __p2_674)); \
57312 __ret_674; \
57313})
57314#else
57315#define vmull_high_lane_s16(__p0_675, __p1_675, __p2_675) __extension__ ({ \
57316 int32x4_t __ret_675; \
57317 int16x8_t __s0_675 = __p0_675; \
57318 int16x4_t __s1_675 = __p1_675; \
57319 int16x8_t __rev0_675; __rev0_675 = __builtin_shufflevector(__s0_675, __s0_675, 7, 6, 5, 4, 3, 2, 1, 0); \
57320 int16x4_t __rev1_675; __rev1_675 = __builtin_shufflevector(__s1_675, __s1_675, 3, 2, 1, 0); \
57321 __ret_675 = __noswap_vmull_s16(__noswap_vget_high_s16(__rev0_675), __noswap_splat_lane_s16(__rev1_675, __p2_675)); \
57322 __ret_675 = __builtin_shufflevector(__ret_675, __ret_675, 3, 2, 1, 0); \
57323 __ret_675; \
57324})
57325#endif
57326
57327#ifdef __LITTLE_ENDIAN__
57328#define vmull_high_laneq_u32(__p0_676, __p1_676, __p2_676) __extension__ ({ \
57329 uint64x2_t __ret_676; \
57330 uint32x4_t __s0_676 = __p0_676; \
57331 uint32x4_t __s1_676 = __p1_676; \
57332 __ret_676 = vmull_u32(vget_high_u32(__s0_676), splat_laneq_u32(__s1_676, __p2_676)); \
57333 __ret_676; \
57334})
57335#else
57336#define vmull_high_laneq_u32(__p0_677, __p1_677, __p2_677) __extension__ ({ \
57337 uint64x2_t __ret_677; \
57338 uint32x4_t __s0_677 = __p0_677; \
57339 uint32x4_t __s1_677 = __p1_677; \
57340 uint32x4_t __rev0_677; __rev0_677 = __builtin_shufflevector(__s0_677, __s0_677, 3, 2, 1, 0); \
57341 uint32x4_t __rev1_677; __rev1_677 = __builtin_shufflevector(__s1_677, __s1_677, 3, 2, 1, 0); \
57342 __ret_677 = __noswap_vmull_u32(__noswap_vget_high_u32(__rev0_677), __noswap_splat_laneq_u32(__rev1_677, __p2_677)); \
57343 __ret_677 = __builtin_shufflevector(__ret_677, __ret_677, 1, 0); \
57344 __ret_677; \
57345})
57346#endif
57347
57348#ifdef __LITTLE_ENDIAN__
57349#define vmull_high_laneq_u16(__p0_678, __p1_678, __p2_678) __extension__ ({ \
57350 uint32x4_t __ret_678; \
57351 uint16x8_t __s0_678 = __p0_678; \
57352 uint16x8_t __s1_678 = __p1_678; \
57353 __ret_678 = vmull_u16(vget_high_u16(__s0_678), splat_laneq_u16(__s1_678, __p2_678)); \
57354 __ret_678; \
57355})
57356#else
57357#define vmull_high_laneq_u16(__p0_679, __p1_679, __p2_679) __extension__ ({ \
57358 uint32x4_t __ret_679; \
57359 uint16x8_t __s0_679 = __p0_679; \
57360 uint16x8_t __s1_679 = __p1_679; \
57361 uint16x8_t __rev0_679; __rev0_679 = __builtin_shufflevector(__s0_679, __s0_679, 7, 6, 5, 4, 3, 2, 1, 0); \
57362 uint16x8_t __rev1_679; __rev1_679 = __builtin_shufflevector(__s1_679, __s1_679, 7, 6, 5, 4, 3, 2, 1, 0); \
57363 __ret_679 = __noswap_vmull_u16(__noswap_vget_high_u16(__rev0_679), __noswap_splat_laneq_u16(__rev1_679, __p2_679)); \
57364 __ret_679 = __builtin_shufflevector(__ret_679, __ret_679, 3, 2, 1, 0); \
57365 __ret_679; \
57366})
57367#endif
57368
57369#ifdef __LITTLE_ENDIAN__
57370#define vmull_high_laneq_s32(__p0_680, __p1_680, __p2_680) __extension__ ({ \
57371 int64x2_t __ret_680; \
57372 int32x4_t __s0_680 = __p0_680; \
57373 int32x4_t __s1_680 = __p1_680; \
57374 __ret_680 = vmull_s32(vget_high_s32(__s0_680), splat_laneq_s32(__s1_680, __p2_680)); \
57375 __ret_680; \
57376})
57377#else
57378#define vmull_high_laneq_s32(__p0_681, __p1_681, __p2_681) __extension__ ({ \
57379 int64x2_t __ret_681; \
57380 int32x4_t __s0_681 = __p0_681; \
57381 int32x4_t __s1_681 = __p1_681; \
57382 int32x4_t __rev0_681; __rev0_681 = __builtin_shufflevector(__s0_681, __s0_681, 3, 2, 1, 0); \
57383 int32x4_t __rev1_681; __rev1_681 = __builtin_shufflevector(__s1_681, __s1_681, 3, 2, 1, 0); \
57384 __ret_681 = __noswap_vmull_s32(__noswap_vget_high_s32(__rev0_681), __noswap_splat_laneq_s32(__rev1_681, __p2_681)); \
57385 __ret_681 = __builtin_shufflevector(__ret_681, __ret_681, 1, 0); \
57386 __ret_681; \
57387})
57388#endif
57389
57390#ifdef __LITTLE_ENDIAN__
57391#define vmull_high_laneq_s16(__p0_682, __p1_682, __p2_682) __extension__ ({ \
57392 int32x4_t __ret_682; \
57393 int16x8_t __s0_682 = __p0_682; \
57394 int16x8_t __s1_682 = __p1_682; \
57395 __ret_682 = vmull_s16(vget_high_s16(__s0_682), splat_laneq_s16(__s1_682, __p2_682)); \
57396 __ret_682; \
57397})
57398#else
57399#define vmull_high_laneq_s16(__p0_683, __p1_683, __p2_683) __extension__ ({ \
57400 int32x4_t __ret_683; \
57401 int16x8_t __s0_683 = __p0_683; \
57402 int16x8_t __s1_683 = __p1_683; \
57403 int16x8_t __rev0_683; __rev0_683 = __builtin_shufflevector(__s0_683, __s0_683, 7, 6, 5, 4, 3, 2, 1, 0); \
57404 int16x8_t __rev1_683; __rev1_683 = __builtin_shufflevector(__s1_683, __s1_683, 7, 6, 5, 4, 3, 2, 1, 0); \
57405 __ret_683 = __noswap_vmull_s16(__noswap_vget_high_s16(__rev0_683), __noswap_splat_laneq_s16(__rev1_683, __p2_683)); \
57406 __ret_683 = __builtin_shufflevector(__ret_683, __ret_683, 3, 2, 1, 0); \
57407 __ret_683; \
57408})
57409#endif
57410
57411#ifdef __LITTLE_ENDIAN__
57412__ai uint64x2_t vmull_high_n_u32(uint32x4_t __p0, uint32_t __p1) {
57413 uint64x2_t __ret;
57414 __ret = vmull_n_u32(vget_high_u32(__p0), __p1);
57657__ai uint32x2_t vreinterpret_u32_s32(int32x2_t __p0) {
57658 uint32x2_t __ret;
57659 __ret = (uint32x2_t)(__p0);
5741557660 return __ret;
5741657661}
57417#else
57418__ai uint64x2_t vmull_high_n_u32(uint32x4_t __p0, uint32_t __p1) {
57419 uint64x2_t __ret;
57420 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
57421 __ret = __noswap_vmull_n_u32(__noswap_vget_high_u32(__rev0), __p1);
57422 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
57662__ai uint32x2_t vreinterpret_u32_s64(int64x1_t __p0) {
57663 uint32x2_t __ret;
57664 __ret = (uint32x2_t)(__p0);
5742357665 return __ret;
5742457666}
57425#endif
57426
57427#ifdef __LITTLE_ENDIAN__
57428__ai uint32x4_t vmull_high_n_u16(uint16x8_t __p0, uint16_t __p1) {
57429 uint32x4_t __ret;
57430 __ret = vmull_n_u16(vget_high_u16(__p0), __p1);
57667__ai uint32x2_t vreinterpret_u32_s16(int16x4_t __p0) {
57668 uint32x2_t __ret;
57669 __ret = (uint32x2_t)(__p0);
5743157670 return __ret;
5743257671}
57433#else
57434__ai uint32x4_t vmull_high_n_u16(uint16x8_t __p0, uint16_t __p1) {
57435 uint32x4_t __ret;
57436 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
57437 __ret = __noswap_vmull_n_u16(__noswap_vget_high_u16(__rev0), __p1);
57438 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
57672__ai uint64x1_t vreinterpret_u64_p8(poly8x8_t __p0) {
57673 uint64x1_t __ret;
57674 __ret = (uint64x1_t)(__p0);
5743957675 return __ret;
5744057676}
57441#endif
57442
57443#ifdef __LITTLE_ENDIAN__
57444__ai int64x2_t vmull_high_n_s32(int32x4_t __p0, int32_t __p1) {
57445 int64x2_t __ret;
57446 __ret = vmull_n_s32(vget_high_s32(__p0), __p1);
57677__ai uint64x1_t vreinterpret_u64_p64(poly64x1_t __p0) {
57678 uint64x1_t __ret;
57679 __ret = (uint64x1_t)(__p0);
5744757680 return __ret;
5744857681}
57449#else
57450__ai int64x2_t vmull_high_n_s32(int32x4_t __p0, int32_t __p1) {
57451 int64x2_t __ret;
57452 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
57453 __ret = __noswap_vmull_n_s32(__noswap_vget_high_s32(__rev0), __p1);
57454 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
57682__ai uint64x1_t vreinterpret_u64_p16(poly16x4_t __p0) {
57683 uint64x1_t __ret;
57684 __ret = (uint64x1_t)(__p0);
5745557685 return __ret;
5745657686}
57457#endif
57458
57459#ifdef __LITTLE_ENDIAN__
57460__ai int32x4_t vmull_high_n_s16(int16x8_t __p0, int16_t __p1) {
57461 int32x4_t __ret;
57462 __ret = vmull_n_s16(vget_high_s16(__p0), __p1);
57687__ai uint64x1_t vreinterpret_u64_u8(uint8x8_t __p0) {
57688 uint64x1_t __ret;
57689 __ret = (uint64x1_t)(__p0);
5746357690 return __ret;
5746457691}
57465#else
57466__ai int32x4_t vmull_high_n_s16(int16x8_t __p0, int16_t __p1) {
57467 int32x4_t __ret;
57468 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
57469 __ret = __noswap_vmull_n_s16(__noswap_vget_high_s16(__rev0), __p1);
57470 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
57692__ai uint64x1_t vreinterpret_u64_u32(uint32x2_t __p0) {
57693 uint64x1_t __ret;
57694 __ret = (uint64x1_t)(__p0);
5747157695 return __ret;
5747257696}
57473#endif
57474
57475#ifdef __LITTLE_ENDIAN__
57476#define vmull_laneq_u32(__p0_684, __p1_684, __p2_684) __extension__ ({ \
57477 uint64x2_t __ret_684; \
57478 uint32x2_t __s0_684 = __p0_684; \
57479 uint32x4_t __s1_684 = __p1_684; \
57480 __ret_684 = vmull_u32(__s0_684, splat_laneq_u32(__s1_684, __p2_684)); \
57481 __ret_684; \
57482})
57483#else
57484#define vmull_laneq_u32(__p0_685, __p1_685, __p2_685) __extension__ ({ \
57485 uint64x2_t __ret_685; \
57486 uint32x2_t __s0_685 = __p0_685; \
57487 uint32x4_t __s1_685 = __p1_685; \
57488 uint32x2_t __rev0_685; __rev0_685 = __builtin_shufflevector(__s0_685, __s0_685, 1, 0); \
57489 uint32x4_t __rev1_685; __rev1_685 = __builtin_shufflevector(__s1_685, __s1_685, 3, 2, 1, 0); \
57490 __ret_685 = __noswap_vmull_u32(__rev0_685, __noswap_splat_laneq_u32(__rev1_685, __p2_685)); \
57491 __ret_685 = __builtin_shufflevector(__ret_685, __ret_685, 1, 0); \
57492 __ret_685; \
57493})
57494#endif
57495
57496#ifdef __LITTLE_ENDIAN__
57497#define vmull_laneq_u16(__p0_686, __p1_686, __p2_686) __extension__ ({ \
57498 uint32x4_t __ret_686; \
57499 uint16x4_t __s0_686 = __p0_686; \
57500 uint16x8_t __s1_686 = __p1_686; \
57501 __ret_686 = vmull_u16(__s0_686, splat_laneq_u16(__s1_686, __p2_686)); \
57502 __ret_686; \
57503})
57504#else
57505#define vmull_laneq_u16(__p0_687, __p1_687, __p2_687) __extension__ ({ \
57506 uint32x4_t __ret_687; \
57507 uint16x4_t __s0_687 = __p0_687; \
57508 uint16x8_t __s1_687 = __p1_687; \
57509 uint16x4_t __rev0_687; __rev0_687 = __builtin_shufflevector(__s0_687, __s0_687, 3, 2, 1, 0); \
57510 uint16x8_t __rev1_687; __rev1_687 = __builtin_shufflevector(__s1_687, __s1_687, 7, 6, 5, 4, 3, 2, 1, 0); \
57511 __ret_687 = __noswap_vmull_u16(__rev0_687, __noswap_splat_laneq_u16(__rev1_687, __p2_687)); \
57512 __ret_687 = __builtin_shufflevector(__ret_687, __ret_687, 3, 2, 1, 0); \
57513 __ret_687; \
57514})
57515#endif
57516
57517#ifdef __LITTLE_ENDIAN__
57518#define vmull_laneq_s32(__p0_688, __p1_688, __p2_688) __extension__ ({ \
57519 int64x2_t __ret_688; \
57520 int32x2_t __s0_688 = __p0_688; \
57521 int32x4_t __s1_688 = __p1_688; \
57522 __ret_688 = vmull_s32(__s0_688, splat_laneq_s32(__s1_688, __p2_688)); \
57523 __ret_688; \
57524})
57525#else
57526#define vmull_laneq_s32(__p0_689, __p1_689, __p2_689) __extension__ ({ \
57527 int64x2_t __ret_689; \
57528 int32x2_t __s0_689 = __p0_689; \
57529 int32x4_t __s1_689 = __p1_689; \
57530 int32x2_t __rev0_689; __rev0_689 = __builtin_shufflevector(__s0_689, __s0_689, 1, 0); \
57531 int32x4_t __rev1_689; __rev1_689 = __builtin_shufflevector(__s1_689, __s1_689, 3, 2, 1, 0); \
57532 __ret_689 = __noswap_vmull_s32(__rev0_689, __noswap_splat_laneq_s32(__rev1_689, __p2_689)); \
57533 __ret_689 = __builtin_shufflevector(__ret_689, __ret_689, 1, 0); \
57534 __ret_689; \
57535})
57536#endif
57537
57538#ifdef __LITTLE_ENDIAN__
57539#define vmull_laneq_s16(__p0_690, __p1_690, __p2_690) __extension__ ({ \
57540 int32x4_t __ret_690; \
57541 int16x4_t __s0_690 = __p0_690; \
57542 int16x8_t __s1_690 = __p1_690; \
57543 __ret_690 = vmull_s16(__s0_690, splat_laneq_s16(__s1_690, __p2_690)); \
57544 __ret_690; \
57545})
57546#else
57547#define vmull_laneq_s16(__p0_691, __p1_691, __p2_691) __extension__ ({ \
57548 int32x4_t __ret_691; \
57549 int16x4_t __s0_691 = __p0_691; \
57550 int16x8_t __s1_691 = __p1_691; \
57551 int16x4_t __rev0_691; __rev0_691 = __builtin_shufflevector(__s0_691, __s0_691, 3, 2, 1, 0); \
57552 int16x8_t __rev1_691; __rev1_691 = __builtin_shufflevector(__s1_691, __s1_691, 7, 6, 5, 4, 3, 2, 1, 0); \
57553 __ret_691 = __noswap_vmull_s16(__rev0_691, __noswap_splat_laneq_s16(__rev1_691, __p2_691)); \
57554 __ret_691 = __builtin_shufflevector(__ret_691, __ret_691, 3, 2, 1, 0); \
57555 __ret_691; \
57556})
57557#endif
57558
57559#ifdef __LITTLE_ENDIAN__
57560__ai float64x2_t vmulxq_f64(float64x2_t __p0, float64x2_t __p1) {
57561 float64x2_t __ret;
57562 __ret = (float64x2_t) __builtin_neon_vmulxq_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
57697__ai uint64x1_t vreinterpret_u64_u16(uint16x4_t __p0) {
57698 uint64x1_t __ret;
57699 __ret = (uint64x1_t)(__p0);
5756357700 return __ret;
5756457701}
57565#else
57566__ai float64x2_t vmulxq_f64(float64x2_t __p0, float64x2_t __p1) {
57567 float64x2_t __ret;
57568 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
57569 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
57570 __ret = (float64x2_t) __builtin_neon_vmulxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
57571 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
57702__ai uint64x1_t vreinterpret_u64_s8(int8x8_t __p0) {
57703 uint64x1_t __ret;
57704 __ret = (uint64x1_t)(__p0);
5757257705 return __ret;
5757357706}
57574__ai float64x2_t __noswap_vmulxq_f64(float64x2_t __p0, float64x2_t __p1) {
57575 float64x2_t __ret;
57576 __ret = (float64x2_t) __builtin_neon_vmulxq_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
57707__ai uint64x1_t vreinterpret_u64_f64(float64x1_t __p0) {
57708 uint64x1_t __ret;
57709 __ret = (uint64x1_t)(__p0);
5757757710 return __ret;
5757857711}
57579#endif
57580
57581#ifdef __LITTLE_ENDIAN__
57582__ai float32x4_t vmulxq_f32(float32x4_t __p0, float32x4_t __p1) {
57583 float32x4_t __ret;
57584 __ret = (float32x4_t) __builtin_neon_vmulxq_v((int8x16_t)__p0, (int8x16_t)__p1, 41);
57712__ai uint64x1_t vreinterpret_u64_f32(float32x2_t __p0) {
57713 uint64x1_t __ret;
57714 __ret = (uint64x1_t)(__p0);
5758557715 return __ret;
5758657716}
57587#else
57588__ai float32x4_t vmulxq_f32(float32x4_t __p0, float32x4_t __p1) {
57589 float32x4_t __ret;
57590 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
57591 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
57592 __ret = (float32x4_t) __builtin_neon_vmulxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 41);
57593 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
57717__ai uint64x1_t vreinterpret_u64_f16(float16x4_t __p0) {
57718 uint64x1_t __ret;
57719 __ret = (uint64x1_t)(__p0);
5759457720 return __ret;
5759557721}
57596__ai float32x4_t __noswap_vmulxq_f32(float32x4_t __p0, float32x4_t __p1) {
57597 float32x4_t __ret;
57598 __ret = (float32x4_t) __builtin_neon_vmulxq_v((int8x16_t)__p0, (int8x16_t)__p1, 41);
57722__ai uint64x1_t vreinterpret_u64_s32(int32x2_t __p0) {
57723 uint64x1_t __ret;
57724 __ret = (uint64x1_t)(__p0);
5759957725 return __ret;
5760057726}
57601#endif
57602
57603__ai float64x1_t vmulx_f64(float64x1_t __p0, float64x1_t __p1) {
57604 float64x1_t __ret;
57605 __ret = (float64x1_t) __builtin_neon_vmulx_v((int8x8_t)__p0, (int8x8_t)__p1, 10);
57727__ai uint64x1_t vreinterpret_u64_s64(int64x1_t __p0) {
57728 uint64x1_t __ret;
57729 __ret = (uint64x1_t)(__p0);
5760657730 return __ret;
5760757731}
57608#ifdef __LITTLE_ENDIAN__
57609__ai float32x2_t vmulx_f32(float32x2_t __p0, float32x2_t __p1) {
57610 float32x2_t __ret;
57611 __ret = (float32x2_t) __builtin_neon_vmulx_v((int8x8_t)__p0, (int8x8_t)__p1, 9);
57732__ai uint64x1_t vreinterpret_u64_s16(int16x4_t __p0) {
57733 uint64x1_t __ret;
57734 __ret = (uint64x1_t)(__p0);
5761257735 return __ret;
5761357736}
57614#else
57615__ai float32x2_t vmulx_f32(float32x2_t __p0, float32x2_t __p1) {
57616 float32x2_t __ret;
57617 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
57618 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
57619 __ret = (float32x2_t) __builtin_neon_vmulx_v((int8x8_t)__rev0, (int8x8_t)__rev1, 9);
57620 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
57737__ai uint16x4_t vreinterpret_u16_p8(poly8x8_t __p0) {
57738 uint16x4_t __ret;
57739 __ret = (uint16x4_t)(__p0);
5762157740 return __ret;
5762257741}
57623__ai float32x2_t __noswap_vmulx_f32(float32x2_t __p0, float32x2_t __p1) {
57624 float32x2_t __ret;
57625 __ret = (float32x2_t) __builtin_neon_vmulx_v((int8x8_t)__p0, (int8x8_t)__p1, 9);
57742__ai uint16x4_t vreinterpret_u16_p64(poly64x1_t __p0) {
57743 uint16x4_t __ret;
57744 __ret = (uint16x4_t)(__p0);
57745 return __ret;
57746}
57747__ai uint16x4_t vreinterpret_u16_p16(poly16x4_t __p0) {
57748 uint16x4_t __ret;
57749 __ret = (uint16x4_t)(__p0);
57750 return __ret;
57751}
57752__ai uint16x4_t vreinterpret_u16_u8(uint8x8_t __p0) {
57753 uint16x4_t __ret;
57754 __ret = (uint16x4_t)(__p0);
57755 return __ret;
57756}
57757__ai uint16x4_t vreinterpret_u16_u32(uint32x2_t __p0) {
57758 uint16x4_t __ret;
57759 __ret = (uint16x4_t)(__p0);
57760 return __ret;
57761}
57762__ai uint16x4_t vreinterpret_u16_u64(uint64x1_t __p0) {
57763 uint16x4_t __ret;
57764 __ret = (uint16x4_t)(__p0);
57765 return __ret;
57766}
57767__ai uint16x4_t vreinterpret_u16_s8(int8x8_t __p0) {
57768 uint16x4_t __ret;
57769 __ret = (uint16x4_t)(__p0);
57770 return __ret;
57771}
57772__ai uint16x4_t vreinterpret_u16_f64(float64x1_t __p0) {
57773 uint16x4_t __ret;
57774 __ret = (uint16x4_t)(__p0);
57775 return __ret;
57776}
57777__ai uint16x4_t vreinterpret_u16_f32(float32x2_t __p0) {
57778 uint16x4_t __ret;
57779 __ret = (uint16x4_t)(__p0);
57780 return __ret;
57781}
57782__ai uint16x4_t vreinterpret_u16_f16(float16x4_t __p0) {
57783 uint16x4_t __ret;
57784 __ret = (uint16x4_t)(__p0);
57785 return __ret;
57786}
57787__ai uint16x4_t vreinterpret_u16_s32(int32x2_t __p0) {
57788 uint16x4_t __ret;
57789 __ret = (uint16x4_t)(__p0);
57790 return __ret;
57791}
57792__ai uint16x4_t vreinterpret_u16_s64(int64x1_t __p0) {
57793 uint16x4_t __ret;
57794 __ret = (uint16x4_t)(__p0);
57795 return __ret;
57796}
57797__ai uint16x4_t vreinterpret_u16_s16(int16x4_t __p0) {
57798 uint16x4_t __ret;
57799 __ret = (uint16x4_t)(__p0);
57800 return __ret;
57801}
57802__ai int8x8_t vreinterpret_s8_p8(poly8x8_t __p0) {
57803 int8x8_t __ret;
57804 __ret = (int8x8_t)(__p0);
57805 return __ret;
57806}
57807__ai int8x8_t vreinterpret_s8_p64(poly64x1_t __p0) {
57808 int8x8_t __ret;
57809 __ret = (int8x8_t)(__p0);
57810 return __ret;
57811}
57812__ai int8x8_t vreinterpret_s8_p16(poly16x4_t __p0) {
57813 int8x8_t __ret;
57814 __ret = (int8x8_t)(__p0);
57815 return __ret;
57816}
57817__ai int8x8_t vreinterpret_s8_u8(uint8x8_t __p0) {
57818 int8x8_t __ret;
57819 __ret = (int8x8_t)(__p0);
57820 return __ret;
57821}
57822__ai int8x8_t vreinterpret_s8_u32(uint32x2_t __p0) {
57823 int8x8_t __ret;
57824 __ret = (int8x8_t)(__p0);
57825 return __ret;
57826}
57827__ai int8x8_t vreinterpret_s8_u64(uint64x1_t __p0) {
57828 int8x8_t __ret;
57829 __ret = (int8x8_t)(__p0);
5762657830 return __ret;
5762757831}
57628#endif
57629
57630__ai float64_t vmulxd_f64(float64_t __p0, float64_t __p1) {
57631 float64_t __ret;
57632 __ret = (float64_t) __builtin_neon_vmulxd_f64(__p0, __p1);
57832__ai int8x8_t vreinterpret_s8_u16(uint16x4_t __p0) {
57833 int8x8_t __ret;
57834 __ret = (int8x8_t)(__p0);
5763357835 return __ret;
5763457836}
57635__ai float32_t vmulxs_f32(float32_t __p0, float32_t __p1) {
57636 float32_t __ret;
57637 __ret = (float32_t) __builtin_neon_vmulxs_f32(__p0, __p1);
57837__ai int8x8_t vreinterpret_s8_f64(float64x1_t __p0) {
57838 int8x8_t __ret;
57839 __ret = (int8x8_t)(__p0);
5763857840 return __ret;
5763957841}
57640#define vmulxd_lane_f64(__p0_692, __p1_692, __p2_692) __extension__ ({ \
57641 float64_t __ret_692; \
57642 float64_t __s0_692 = __p0_692; \
57643 float64x1_t __s1_692 = __p1_692; \
57644 __ret_692 = vmulxd_f64(__s0_692, vget_lane_f64(__s1_692, __p2_692)); \
57645 __ret_692; \
57646})
57647#ifdef __LITTLE_ENDIAN__
57648#define vmulxs_lane_f32(__p0_693, __p1_693, __p2_693) __extension__ ({ \
57649 float32_t __ret_693; \
57650 float32_t __s0_693 = __p0_693; \
57651 float32x2_t __s1_693 = __p1_693; \
57652 __ret_693 = vmulxs_f32(__s0_693, vget_lane_f32(__s1_693, __p2_693)); \
57653 __ret_693; \
57654})
57655#else
57656#define vmulxs_lane_f32(__p0_694, __p1_694, __p2_694) __extension__ ({ \
57657 float32_t __ret_694; \
57658 float32_t __s0_694 = __p0_694; \
57659 float32x2_t __s1_694 = __p1_694; \
57660 float32x2_t __rev1_694; __rev1_694 = __builtin_shufflevector(__s1_694, __s1_694, 1, 0); \
57661 __ret_694 = vmulxs_f32(__s0_694, __noswap_vget_lane_f32(__rev1_694, __p2_694)); \
57662 __ret_694; \
57663})
57664#endif
57665
57666#ifdef __LITTLE_ENDIAN__
57667#define vmulxq_lane_f64(__p0_695, __p1_695, __p2_695) __extension__ ({ \
57668 float64x2_t __ret_695; \
57669 float64x2_t __s0_695 = __p0_695; \
57670 float64x1_t __s1_695 = __p1_695; \
57671 __ret_695 = vmulxq_f64(__s0_695, splatq_lane_f64(__s1_695, __p2_695)); \
57672 __ret_695; \
57673})
57674#else
57675#define vmulxq_lane_f64(__p0_696, __p1_696, __p2_696) __extension__ ({ \
57676 float64x2_t __ret_696; \
57677 float64x2_t __s0_696 = __p0_696; \
57678 float64x1_t __s1_696 = __p1_696; \
57679 float64x2_t __rev0_696; __rev0_696 = __builtin_shufflevector(__s0_696, __s0_696, 1, 0); \
57680 __ret_696 = __noswap_vmulxq_f64(__rev0_696, __noswap_splatq_lane_f64(__s1_696, __p2_696)); \
57681 __ret_696 = __builtin_shufflevector(__ret_696, __ret_696, 1, 0); \
57682 __ret_696; \
57683})
57684#endif
57685
57686#ifdef __LITTLE_ENDIAN__
57687#define vmulxq_lane_f32(__p0_697, __p1_697, __p2_697) __extension__ ({ \
57688 float32x4_t __ret_697; \
57689 float32x4_t __s0_697 = __p0_697; \
57690 float32x2_t __s1_697 = __p1_697; \
57691 __ret_697 = vmulxq_f32(__s0_697, splatq_lane_f32(__s1_697, __p2_697)); \
57692 __ret_697; \
57693})
57694#else
57695#define vmulxq_lane_f32(__p0_698, __p1_698, __p2_698) __extension__ ({ \
57696 float32x4_t __ret_698; \
57697 float32x4_t __s0_698 = __p0_698; \
57698 float32x2_t __s1_698 = __p1_698; \
57699 float32x4_t __rev0_698; __rev0_698 = __builtin_shufflevector(__s0_698, __s0_698, 3, 2, 1, 0); \
57700 float32x2_t __rev1_698; __rev1_698 = __builtin_shufflevector(__s1_698, __s1_698, 1, 0); \
57701 __ret_698 = __noswap_vmulxq_f32(__rev0_698, __noswap_splatq_lane_f32(__rev1_698, __p2_698)); \
57702 __ret_698 = __builtin_shufflevector(__ret_698, __ret_698, 3, 2, 1, 0); \
57703 __ret_698; \
57704})
57705#endif
57706
57707#ifdef __LITTLE_ENDIAN__
57708#define vmulx_lane_f32(__p0_699, __p1_699, __p2_699) __extension__ ({ \
57709 float32x2_t __ret_699; \
57710 float32x2_t __s0_699 = __p0_699; \
57711 float32x2_t __s1_699 = __p1_699; \
57712 __ret_699 = vmulx_f32(__s0_699, splat_lane_f32(__s1_699, __p2_699)); \
57713 __ret_699; \
57714})
57715#else
57716#define vmulx_lane_f32(__p0_700, __p1_700, __p2_700) __extension__ ({ \
57717 float32x2_t __ret_700; \
57718 float32x2_t __s0_700 = __p0_700; \
57719 float32x2_t __s1_700 = __p1_700; \
57720 float32x2_t __rev0_700; __rev0_700 = __builtin_shufflevector(__s0_700, __s0_700, 1, 0); \
57721 float32x2_t __rev1_700; __rev1_700 = __builtin_shufflevector(__s1_700, __s1_700, 1, 0); \
57722 __ret_700 = __noswap_vmulx_f32(__rev0_700, __noswap_splat_lane_f32(__rev1_700, __p2_700)); \
57723 __ret_700 = __builtin_shufflevector(__ret_700, __ret_700, 1, 0); \
57724 __ret_700; \
57725})
57726#endif
57727
57728#ifdef __LITTLE_ENDIAN__
57729#define vmulxd_laneq_f64(__p0_701, __p1_701, __p2_701) __extension__ ({ \
57730 float64_t __ret_701; \
57731 float64_t __s0_701 = __p0_701; \
57732 float64x2_t __s1_701 = __p1_701; \
57733 __ret_701 = vmulxd_f64(__s0_701, vgetq_lane_f64(__s1_701, __p2_701)); \
57734 __ret_701; \
57735})
57736#else
57737#define vmulxd_laneq_f64(__p0_702, __p1_702, __p2_702) __extension__ ({ \
57738 float64_t __ret_702; \
57739 float64_t __s0_702 = __p0_702; \
57740 float64x2_t __s1_702 = __p1_702; \
57741 float64x2_t __rev1_702; __rev1_702 = __builtin_shufflevector(__s1_702, __s1_702, 1, 0); \
57742 __ret_702 = vmulxd_f64(__s0_702, __noswap_vgetq_lane_f64(__rev1_702, __p2_702)); \
57743 __ret_702; \
57744})
57745#endif
57746
57747#ifdef __LITTLE_ENDIAN__
57748#define vmulxs_laneq_f32(__p0_703, __p1_703, __p2_703) __extension__ ({ \
57749 float32_t __ret_703; \
57750 float32_t __s0_703 = __p0_703; \
57751 float32x4_t __s1_703 = __p1_703; \
57752 __ret_703 = vmulxs_f32(__s0_703, vgetq_lane_f32(__s1_703, __p2_703)); \
57753 __ret_703; \
57754})
57755#else
57756#define vmulxs_laneq_f32(__p0_704, __p1_704, __p2_704) __extension__ ({ \
57757 float32_t __ret_704; \
57758 float32_t __s0_704 = __p0_704; \
57759 float32x4_t __s1_704 = __p1_704; \
57760 float32x4_t __rev1_704; __rev1_704 = __builtin_shufflevector(__s1_704, __s1_704, 3, 2, 1, 0); \
57761 __ret_704 = vmulxs_f32(__s0_704, __noswap_vgetq_lane_f32(__rev1_704, __p2_704)); \
57762 __ret_704; \
57763})
57764#endif
57765
57766#ifdef __LITTLE_ENDIAN__
57767#define vmulxq_laneq_f64(__p0_705, __p1_705, __p2_705) __extension__ ({ \
57768 float64x2_t __ret_705; \
57769 float64x2_t __s0_705 = __p0_705; \
57770 float64x2_t __s1_705 = __p1_705; \
57771 __ret_705 = vmulxq_f64(__s0_705, splatq_laneq_f64(__s1_705, __p2_705)); \
57772 __ret_705; \
57773})
57774#else
57775#define vmulxq_laneq_f64(__p0_706, __p1_706, __p2_706) __extension__ ({ \
57776 float64x2_t __ret_706; \
57777 float64x2_t __s0_706 = __p0_706; \
57778 float64x2_t __s1_706 = __p1_706; \
57779 float64x2_t __rev0_706; __rev0_706 = __builtin_shufflevector(__s0_706, __s0_706, 1, 0); \
57780 float64x2_t __rev1_706; __rev1_706 = __builtin_shufflevector(__s1_706, __s1_706, 1, 0); \
57781 __ret_706 = __noswap_vmulxq_f64(__rev0_706, __noswap_splatq_laneq_f64(__rev1_706, __p2_706)); \
57782 __ret_706 = __builtin_shufflevector(__ret_706, __ret_706, 1, 0); \
57783 __ret_706; \
57784})
57785#endif
57786
57787#ifdef __LITTLE_ENDIAN__
57788#define vmulxq_laneq_f32(__p0_707, __p1_707, __p2_707) __extension__ ({ \
57789 float32x4_t __ret_707; \
57790 float32x4_t __s0_707 = __p0_707; \
57791 float32x4_t __s1_707 = __p1_707; \
57792 __ret_707 = vmulxq_f32(__s0_707, splatq_laneq_f32(__s1_707, __p2_707)); \
57793 __ret_707; \
57794})
57795#else
57796#define vmulxq_laneq_f32(__p0_708, __p1_708, __p2_708) __extension__ ({ \
57797 float32x4_t __ret_708; \
57798 float32x4_t __s0_708 = __p0_708; \
57799 float32x4_t __s1_708 = __p1_708; \
57800 float32x4_t __rev0_708; __rev0_708 = __builtin_shufflevector(__s0_708, __s0_708, 3, 2, 1, 0); \
57801 float32x4_t __rev1_708; __rev1_708 = __builtin_shufflevector(__s1_708, __s1_708, 3, 2, 1, 0); \
57802 __ret_708 = __noswap_vmulxq_f32(__rev0_708, __noswap_splatq_laneq_f32(__rev1_708, __p2_708)); \
57803 __ret_708 = __builtin_shufflevector(__ret_708, __ret_708, 3, 2, 1, 0); \
57804 __ret_708; \
57805})
57806#endif
57807
57808#ifdef __LITTLE_ENDIAN__
57809#define vmulx_laneq_f32(__p0_709, __p1_709, __p2_709) __extension__ ({ \
57810 float32x2_t __ret_709; \
57811 float32x2_t __s0_709 = __p0_709; \
57812 float32x4_t __s1_709 = __p1_709; \
57813 __ret_709 = vmulx_f32(__s0_709, splat_laneq_f32(__s1_709, __p2_709)); \
57814 __ret_709; \
57815})
57816#else
57817#define vmulx_laneq_f32(__p0_710, __p1_710, __p2_710) __extension__ ({ \
57818 float32x2_t __ret_710; \
57819 float32x2_t __s0_710 = __p0_710; \
57820 float32x4_t __s1_710 = __p1_710; \
57821 float32x2_t __rev0_710; __rev0_710 = __builtin_shufflevector(__s0_710, __s0_710, 1, 0); \
57822 float32x4_t __rev1_710; __rev1_710 = __builtin_shufflevector(__s1_710, __s1_710, 3, 2, 1, 0); \
57823 __ret_710 = __noswap_vmulx_f32(__rev0_710, __noswap_splat_laneq_f32(__rev1_710, __p2_710)); \
57824 __ret_710 = __builtin_shufflevector(__ret_710, __ret_710, 1, 0); \
57825 __ret_710; \
57826})
57827#endif
57828
57829#ifdef __LITTLE_ENDIAN__
57830__ai float64x2_t vnegq_f64(float64x2_t __p0) {
57831 float64x2_t __ret;
57832 __ret = -__p0;
57842__ai int8x8_t vreinterpret_s8_f32(float32x2_t __p0) {
57843 int8x8_t __ret;
57844 __ret = (int8x8_t)(__p0);
5783357845 return __ret;
5783457846}
57835#else
57836__ai float64x2_t vnegq_f64(float64x2_t __p0) {
57837 float64x2_t __ret;
57838 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
57839 __ret = -__rev0;
57840 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
57847__ai int8x8_t vreinterpret_s8_f16(float16x4_t __p0) {
57848 int8x8_t __ret;
57849 __ret = (int8x8_t)(__p0);
5784157850 return __ret;
5784257851}
57843#endif
57844
57845#ifdef __LITTLE_ENDIAN__
57846__ai int64x2_t vnegq_s64(int64x2_t __p0) {
57847 int64x2_t __ret;
57848 __ret = -__p0;
57852__ai int8x8_t vreinterpret_s8_s32(int32x2_t __p0) {
57853 int8x8_t __ret;
57854 __ret = (int8x8_t)(__p0);
5784957855 return __ret;
5785057856}
57851#else
57852__ai int64x2_t vnegq_s64(int64x2_t __p0) {
57853 int64x2_t __ret;
57854 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
57855 __ret = -__rev0;
57856 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
57857__ai int8x8_t vreinterpret_s8_s64(int64x1_t __p0) {
57858 int8x8_t __ret;
57859 __ret = (int8x8_t)(__p0);
5785757860 return __ret;
5785857861}
57859#endif
57860
57861__ai float64x1_t vneg_f64(float64x1_t __p0) {
57862 float64x1_t __ret;
57863 __ret = -__p0;
57862__ai int8x8_t vreinterpret_s8_s16(int16x4_t __p0) {
57863 int8x8_t __ret;
57864 __ret = (int8x8_t)(__p0);
5786457865 return __ret;
5786557866}
57866__ai int64x1_t vneg_s64(int64x1_t __p0) {
57867 int64x1_t __ret;
57868 __ret = -__p0;
57867__ai float64x1_t vreinterpret_f64_p8(poly8x8_t __p0) {
57868 float64x1_t __ret;
57869 __ret = (float64x1_t)(__p0);
5786957870 return __ret;
5787057871}
57871__ai int64_t vnegd_s64(int64_t __p0) {
57872 int64_t __ret;
57873 __ret = (int64_t) __builtin_neon_vnegd_s64(__p0);
57872__ai float64x1_t vreinterpret_f64_p64(poly64x1_t __p0) {
57873 float64x1_t __ret;
57874 __ret = (float64x1_t)(__p0);
5787457875 return __ret;
5787557876}
57876#ifdef __LITTLE_ENDIAN__
57877__ai uint8x16_t vpaddq_u8(uint8x16_t __p0, uint8x16_t __p1) {
57878 uint8x16_t __ret;
57879 __ret = (uint8x16_t) __builtin_neon_vpaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 48);
57877__ai float64x1_t vreinterpret_f64_p16(poly16x4_t __p0) {
57878 float64x1_t __ret;
57879 __ret = (float64x1_t)(__p0);
5788057880 return __ret;
5788157881}
57882#else
57883__ai uint8x16_t vpaddq_u8(uint8x16_t __p0, uint8x16_t __p1) {
57884 uint8x16_t __ret;
57885 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
57886 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
57887 __ret = (uint8x16_t) __builtin_neon_vpaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 48);
57888 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
57882__ai float64x1_t vreinterpret_f64_u8(uint8x8_t __p0) {
57883 float64x1_t __ret;
57884 __ret = (float64x1_t)(__p0);
5788957885 return __ret;
5789057886}
57891#endif
57892
57893#ifdef __LITTLE_ENDIAN__
57894__ai uint32x4_t vpaddq_u32(uint32x4_t __p0, uint32x4_t __p1) {
57895 uint32x4_t __ret;
57896 __ret = (uint32x4_t) __builtin_neon_vpaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 50);
57887__ai float64x1_t vreinterpret_f64_u32(uint32x2_t __p0) {
57888 float64x1_t __ret;
57889 __ret = (float64x1_t)(__p0);
5789757890 return __ret;
5789857891}
57899#else
57900__ai uint32x4_t vpaddq_u32(uint32x4_t __p0, uint32x4_t __p1) {
57901 uint32x4_t __ret;
57902 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
57903 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
57904 __ret = (uint32x4_t) __builtin_neon_vpaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 50);
57905 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
57892__ai float64x1_t vreinterpret_f64_u64(uint64x1_t __p0) {
57893 float64x1_t __ret;
57894 __ret = (float64x1_t)(__p0);
5790657895 return __ret;
5790757896}
57908#endif
57909
57910#ifdef __LITTLE_ENDIAN__
57911__ai uint64x2_t vpaddq_u64(uint64x2_t __p0, uint64x2_t __p1) {
57912 uint64x2_t __ret;
57913 __ret = (uint64x2_t) __builtin_neon_vpaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 51);
57897__ai float64x1_t vreinterpret_f64_u16(uint16x4_t __p0) {
57898 float64x1_t __ret;
57899 __ret = (float64x1_t)(__p0);
5791457900 return __ret;
5791557901}
57916#else
57917__ai uint64x2_t vpaddq_u64(uint64x2_t __p0, uint64x2_t __p1) {
57918 uint64x2_t __ret;
57919 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
57920 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
57921 __ret = (uint64x2_t) __builtin_neon_vpaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 51);
57922 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
57902__ai float64x1_t vreinterpret_f64_s8(int8x8_t __p0) {
57903 float64x1_t __ret;
57904 __ret = (float64x1_t)(__p0);
5792357905 return __ret;
5792457906}
57925#endif
57926
57927#ifdef __LITTLE_ENDIAN__
57928__ai uint16x8_t vpaddq_u16(uint16x8_t __p0, uint16x8_t __p1) {
57929 uint16x8_t __ret;
57930 __ret = (uint16x8_t) __builtin_neon_vpaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 49);
57907__ai float64x1_t vreinterpret_f64_f32(float32x2_t __p0) {
57908 float64x1_t __ret;
57909 __ret = (float64x1_t)(__p0);
5793157910 return __ret;
5793257911}
57933#else
57934__ai uint16x8_t vpaddq_u16(uint16x8_t __p0, uint16x8_t __p1) {
57935 uint16x8_t __ret;
57936 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
57937 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
57938 __ret = (uint16x8_t) __builtin_neon_vpaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 49);
57939 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
57912__ai float64x1_t vreinterpret_f64_f16(float16x4_t __p0) {
57913 float64x1_t __ret;
57914 __ret = (float64x1_t)(__p0);
5794057915 return __ret;
5794157916}
57942#endif
57943
57944#ifdef __LITTLE_ENDIAN__
57945__ai int8x16_t vpaddq_s8(int8x16_t __p0, int8x16_t __p1) {
57946 int8x16_t __ret;
57947 __ret = (int8x16_t) __builtin_neon_vpaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 32);
57917__ai float64x1_t vreinterpret_f64_s32(int32x2_t __p0) {
57918 float64x1_t __ret;
57919 __ret = (float64x1_t)(__p0);
5794857920 return __ret;
5794957921}
57950#else
57951__ai int8x16_t vpaddq_s8(int8x16_t __p0, int8x16_t __p1) {
57952 int8x16_t __ret;
57953 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
57954 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
57955 __ret = (int8x16_t) __builtin_neon_vpaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 32);
57956 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
57922__ai float64x1_t vreinterpret_f64_s64(int64x1_t __p0) {
57923 float64x1_t __ret;
57924 __ret = (float64x1_t)(__p0);
5795757925 return __ret;
5795857926}
57959#endif
57960
57961#ifdef __LITTLE_ENDIAN__
57962__ai float64x2_t vpaddq_f64(float64x2_t __p0, float64x2_t __p1) {
57963 float64x2_t __ret;
57964 __ret = (float64x2_t) __builtin_neon_vpaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
57927__ai float64x1_t vreinterpret_f64_s16(int16x4_t __p0) {
57928 float64x1_t __ret;
57929 __ret = (float64x1_t)(__p0);
5796557930 return __ret;
5796657931}
57967#else
57968__ai float64x2_t vpaddq_f64(float64x2_t __p0, float64x2_t __p1) {
57969 float64x2_t __ret;
57970 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
57971 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
57972 __ret = (float64x2_t) __builtin_neon_vpaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
57973 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
57932__ai float32x2_t vreinterpret_f32_p8(poly8x8_t __p0) {
57933 float32x2_t __ret;
57934 __ret = (float32x2_t)(__p0);
5797457935 return __ret;
5797557936}
57976#endif
57977
57978#ifdef __LITTLE_ENDIAN__
57979__ai float32x4_t vpaddq_f32(float32x4_t __p0, float32x4_t __p1) {
57980 float32x4_t __ret;
57981 __ret = (float32x4_t) __builtin_neon_vpaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 41);
57937__ai float32x2_t vreinterpret_f32_p64(poly64x1_t __p0) {
57938 float32x2_t __ret;
57939 __ret = (float32x2_t)(__p0);
5798257940 return __ret;
5798357941}
57984#else
57985__ai float32x4_t vpaddq_f32(float32x4_t __p0, float32x4_t __p1) {
57986 float32x4_t __ret;
57987 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
57988 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
57989 __ret = (float32x4_t) __builtin_neon_vpaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 41);
57990 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
57942__ai float32x2_t vreinterpret_f32_p16(poly16x4_t __p0) {
57943 float32x2_t __ret;
57944 __ret = (float32x2_t)(__p0);
5799157945 return __ret;
5799257946}
57993#endif
57994
57995#ifdef __LITTLE_ENDIAN__
57996__ai int32x4_t vpaddq_s32(int32x4_t __p0, int32x4_t __p1) {
57997 int32x4_t __ret;
57998 __ret = (int32x4_t) __builtin_neon_vpaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 34);
57947__ai float32x2_t vreinterpret_f32_u8(uint8x8_t __p0) {
57948 float32x2_t __ret;
57949 __ret = (float32x2_t)(__p0);
5799957950 return __ret;
5800057951}
58001#else
58002__ai int32x4_t vpaddq_s32(int32x4_t __p0, int32x4_t __p1) {
58003 int32x4_t __ret;
58004 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
58005 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
58006 __ret = (int32x4_t) __builtin_neon_vpaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 34);
58007 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
57952__ai float32x2_t vreinterpret_f32_u32(uint32x2_t __p0) {
57953 float32x2_t __ret;
57954 __ret = (float32x2_t)(__p0);
5800857955 return __ret;
5800957956}
58010#endif
58011
58012#ifdef __LITTLE_ENDIAN__
58013__ai int64x2_t vpaddq_s64(int64x2_t __p0, int64x2_t __p1) {
58014 int64x2_t __ret;
58015 __ret = (int64x2_t) __builtin_neon_vpaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 35);
57957__ai float32x2_t vreinterpret_f32_u64(uint64x1_t __p0) {
57958 float32x2_t __ret;
57959 __ret = (float32x2_t)(__p0);
5801657960 return __ret;
5801757961}
58018#else
58019__ai int64x2_t vpaddq_s64(int64x2_t __p0, int64x2_t __p1) {
58020 int64x2_t __ret;
58021 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
58022 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
58023 __ret = (int64x2_t) __builtin_neon_vpaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 35);
58024 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
57962__ai float32x2_t vreinterpret_f32_u16(uint16x4_t __p0) {
57963 float32x2_t __ret;
57964 __ret = (float32x2_t)(__p0);
5802557965 return __ret;
5802657966}
58027#endif
58028
58029#ifdef __LITTLE_ENDIAN__
58030__ai int16x8_t vpaddq_s16(int16x8_t __p0, int16x8_t __p1) {
58031 int16x8_t __ret;
58032 __ret = (int16x8_t) __builtin_neon_vpaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 33);
57967__ai float32x2_t vreinterpret_f32_s8(int8x8_t __p0) {
57968 float32x2_t __ret;
57969 __ret = (float32x2_t)(__p0);
5803357970 return __ret;
5803457971}
58035#else
58036__ai int16x8_t vpaddq_s16(int16x8_t __p0, int16x8_t __p1) {
58037 int16x8_t __ret;
58038 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
58039 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
58040 __ret = (int16x8_t) __builtin_neon_vpaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 33);
58041 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
57972__ai float32x2_t vreinterpret_f32_f64(float64x1_t __p0) {
57973 float32x2_t __ret;
57974 __ret = (float32x2_t)(__p0);
5804257975 return __ret;
5804357976}
58044#endif
58045
58046#ifdef __LITTLE_ENDIAN__
58047__ai uint64_t vpaddd_u64(uint64x2_t __p0) {
58048 uint64_t __ret;
58049 __ret = (uint64_t) __builtin_neon_vpaddd_u64(__p0);
57977__ai float32x2_t vreinterpret_f32_f16(float16x4_t __p0) {
57978 float32x2_t __ret;
57979 __ret = (float32x2_t)(__p0);
5805057980 return __ret;
5805157981}
58052#else
58053__ai uint64_t vpaddd_u64(uint64x2_t __p0) {
58054 uint64_t __ret;
58055 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
58056 __ret = (uint64_t) __builtin_neon_vpaddd_u64(__rev0);
57982__ai float32x2_t vreinterpret_f32_s32(int32x2_t __p0) {
57983 float32x2_t __ret;
57984 __ret = (float32x2_t)(__p0);
5805757985 return __ret;
5805857986}
58059#endif
58060
58061#ifdef __LITTLE_ENDIAN__
58062__ai float64_t vpaddd_f64(float64x2_t __p0) {
58063 float64_t __ret;
58064 __ret = (float64_t) __builtin_neon_vpaddd_f64(__p0);
57987__ai float32x2_t vreinterpret_f32_s64(int64x1_t __p0) {
57988 float32x2_t __ret;
57989 __ret = (float32x2_t)(__p0);
5806557990 return __ret;
5806657991}
58067#else
58068__ai float64_t vpaddd_f64(float64x2_t __p0) {
58069 float64_t __ret;
58070 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
58071 __ret = (float64_t) __builtin_neon_vpaddd_f64(__rev0);
57992__ai float32x2_t vreinterpret_f32_s16(int16x4_t __p0) {
57993 float32x2_t __ret;
57994 __ret = (float32x2_t)(__p0);
5807257995 return __ret;
5807357996}
58074#endif
58075
58076#ifdef __LITTLE_ENDIAN__
58077__ai int64_t vpaddd_s64(int64x2_t __p0) {
58078 int64_t __ret;
58079 __ret = (int64_t) __builtin_neon_vpaddd_s64(__p0);
57997__ai float16x4_t vreinterpret_f16_p8(poly8x8_t __p0) {
57998 float16x4_t __ret;
57999 __ret = (float16x4_t)(__p0);
5808058000 return __ret;
5808158001}
58082#else
58083__ai int64_t vpaddd_s64(int64x2_t __p0) {
58084 int64_t __ret;
58085 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
58086 __ret = (int64_t) __builtin_neon_vpaddd_s64(__rev0);
58002__ai float16x4_t vreinterpret_f16_p64(poly64x1_t __p0) {
58003 float16x4_t __ret;
58004 __ret = (float16x4_t)(__p0);
5808758005 return __ret;
5808858006}
58089#endif
58090
58091#ifdef __LITTLE_ENDIAN__
58092__ai float32_t vpadds_f32(float32x2_t __p0) {
58093 float32_t __ret;
58094 __ret = (float32_t) __builtin_neon_vpadds_f32(__p0);
58007__ai float16x4_t vreinterpret_f16_p16(poly16x4_t __p0) {
58008 float16x4_t __ret;
58009 __ret = (float16x4_t)(__p0);
5809558010 return __ret;
5809658011}
58097#else
58098__ai float32_t vpadds_f32(float32x2_t __p0) {
58099 float32_t __ret;
58100 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
58101 __ret = (float32_t) __builtin_neon_vpadds_f32(__rev0);
58012__ai float16x4_t vreinterpret_f16_u8(uint8x8_t __p0) {
58013 float16x4_t __ret;
58014 __ret = (float16x4_t)(__p0);
5810258015 return __ret;
5810358016}
58104#endif
58105
58106#ifdef __LITTLE_ENDIAN__
58107__ai uint8x16_t vpmaxq_u8(uint8x16_t __p0, uint8x16_t __p1) {
58108 uint8x16_t __ret;
58109 __ret = (uint8x16_t) __builtin_neon_vpmaxq_v((int8x16_t)__p0, (int8x16_t)__p1, 48);
58017__ai float16x4_t vreinterpret_f16_u32(uint32x2_t __p0) {
58018 float16x4_t __ret;
58019 __ret = (float16x4_t)(__p0);
5811058020 return __ret;
5811158021}
58112#else
58113__ai uint8x16_t vpmaxq_u8(uint8x16_t __p0, uint8x16_t __p1) {
58114 uint8x16_t __ret;
58115 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
58116 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
58117 __ret = (uint8x16_t) __builtin_neon_vpmaxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 48);
58118 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
58022__ai float16x4_t vreinterpret_f16_u64(uint64x1_t __p0) {
58023 float16x4_t __ret;
58024 __ret = (float16x4_t)(__p0);
5811958025 return __ret;
5812058026}
58121#endif
58122
58123#ifdef __LITTLE_ENDIAN__
58124__ai uint32x4_t vpmaxq_u32(uint32x4_t __p0, uint32x4_t __p1) {
58125 uint32x4_t __ret;
58126 __ret = (uint32x4_t) __builtin_neon_vpmaxq_v((int8x16_t)__p0, (int8x16_t)__p1, 50);
58027__ai float16x4_t vreinterpret_f16_u16(uint16x4_t __p0) {
58028 float16x4_t __ret;
58029 __ret = (float16x4_t)(__p0);
5812758030 return __ret;
5812858031}
58129#else
58130__ai uint32x4_t vpmaxq_u32(uint32x4_t __p0, uint32x4_t __p1) {
58131 uint32x4_t __ret;
58132 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
58133 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
58134 __ret = (uint32x4_t) __builtin_neon_vpmaxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 50);
58135 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
58032__ai float16x4_t vreinterpret_f16_s8(int8x8_t __p0) {
58033 float16x4_t __ret;
58034 __ret = (float16x4_t)(__p0);
5813658035 return __ret;
5813758036}
58138#endif
58139
58140#ifdef __LITTLE_ENDIAN__
58141__ai uint16x8_t vpmaxq_u16(uint16x8_t __p0, uint16x8_t __p1) {
58142 uint16x8_t __ret;
58143 __ret = (uint16x8_t) __builtin_neon_vpmaxq_v((int8x16_t)__p0, (int8x16_t)__p1, 49);
58037__ai float16x4_t vreinterpret_f16_f64(float64x1_t __p0) {
58038 float16x4_t __ret;
58039 __ret = (float16x4_t)(__p0);
5814458040 return __ret;
5814558041}
58146#else
58147__ai uint16x8_t vpmaxq_u16(uint16x8_t __p0, uint16x8_t __p1) {
58148 uint16x8_t __ret;
58149 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
58150 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
58151 __ret = (uint16x8_t) __builtin_neon_vpmaxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 49);
58152 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
58042__ai float16x4_t vreinterpret_f16_f32(float32x2_t __p0) {
58043 float16x4_t __ret;
58044 __ret = (float16x4_t)(__p0);
5815358045 return __ret;
5815458046}
58155#endif
58156
58157#ifdef __LITTLE_ENDIAN__
58158__ai int8x16_t vpmaxq_s8(int8x16_t __p0, int8x16_t __p1) {
58159 int8x16_t __ret;
58160 __ret = (int8x16_t) __builtin_neon_vpmaxq_v((int8x16_t)__p0, (int8x16_t)__p1, 32);
58047__ai float16x4_t vreinterpret_f16_s32(int32x2_t __p0) {
58048 float16x4_t __ret;
58049 __ret = (float16x4_t)(__p0);
5816158050 return __ret;
5816258051}
58163#else
58164__ai int8x16_t vpmaxq_s8(int8x16_t __p0, int8x16_t __p1) {
58165 int8x16_t __ret;
58166 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
58167 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
58168 __ret = (int8x16_t) __builtin_neon_vpmaxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 32);
58169 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
58052__ai float16x4_t vreinterpret_f16_s64(int64x1_t __p0) {
58053 float16x4_t __ret;
58054 __ret = (float16x4_t)(__p0);
5817058055 return __ret;
5817158056}
58172#endif
58173
58174#ifdef __LITTLE_ENDIAN__
58175__ai float64x2_t vpmaxq_f64(float64x2_t __p0, float64x2_t __p1) {
58176 float64x2_t __ret;
58177 __ret = (float64x2_t) __builtin_neon_vpmaxq_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
58057__ai float16x4_t vreinterpret_f16_s16(int16x4_t __p0) {
58058 float16x4_t __ret;
58059 __ret = (float16x4_t)(__p0);
5817858060 return __ret;
5817958061}
58180#else
58181__ai float64x2_t vpmaxq_f64(float64x2_t __p0, float64x2_t __p1) {
58182 float64x2_t __ret;
58183 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
58184 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
58185 __ret = (float64x2_t) __builtin_neon_vpmaxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
58186 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
58062__ai int32x2_t vreinterpret_s32_p8(poly8x8_t __p0) {
58063 int32x2_t __ret;
58064 __ret = (int32x2_t)(__p0);
5818758065 return __ret;
5818858066}
58189#endif
58190
58191#ifdef __LITTLE_ENDIAN__
58192__ai float32x4_t vpmaxq_f32(float32x4_t __p0, float32x4_t __p1) {
58193 float32x4_t __ret;
58194 __ret = (float32x4_t) __builtin_neon_vpmaxq_v((int8x16_t)__p0, (int8x16_t)__p1, 41);
58067__ai int32x2_t vreinterpret_s32_p64(poly64x1_t __p0) {
58068 int32x2_t __ret;
58069 __ret = (int32x2_t)(__p0);
5819558070 return __ret;
5819658071}
58197#else
58198__ai float32x4_t vpmaxq_f32(float32x4_t __p0, float32x4_t __p1) {
58199 float32x4_t __ret;
58200 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
58201 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
58202 __ret = (float32x4_t) __builtin_neon_vpmaxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 41);
58203 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
58072__ai int32x2_t vreinterpret_s32_p16(poly16x4_t __p0) {
58073 int32x2_t __ret;
58074 __ret = (int32x2_t)(__p0);
5820458075 return __ret;
5820558076}
58206#endif
58207
58208#ifdef __LITTLE_ENDIAN__
58209__ai int32x4_t vpmaxq_s32(int32x4_t __p0, int32x4_t __p1) {
58210 int32x4_t __ret;
58211 __ret = (int32x4_t) __builtin_neon_vpmaxq_v((int8x16_t)__p0, (int8x16_t)__p1, 34);
58077__ai int32x2_t vreinterpret_s32_u8(uint8x8_t __p0) {
58078 int32x2_t __ret;
58079 __ret = (int32x2_t)(__p0);
5821258080 return __ret;
5821358081}
58214#else
58215__ai int32x4_t vpmaxq_s32(int32x4_t __p0, int32x4_t __p1) {
58216 int32x4_t __ret;
58217 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
58218 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
58219 __ret = (int32x4_t) __builtin_neon_vpmaxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 34);
58220 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
58082__ai int32x2_t vreinterpret_s32_u32(uint32x2_t __p0) {
58083 int32x2_t __ret;
58084 __ret = (int32x2_t)(__p0);
5822158085 return __ret;
5822258086}
58223#endif
58224
58225#ifdef __LITTLE_ENDIAN__
58226__ai int16x8_t vpmaxq_s16(int16x8_t __p0, int16x8_t __p1) {
58227 int16x8_t __ret;
58228 __ret = (int16x8_t) __builtin_neon_vpmaxq_v((int8x16_t)__p0, (int8x16_t)__p1, 33);
58087__ai int32x2_t vreinterpret_s32_u64(uint64x1_t __p0) {
58088 int32x2_t __ret;
58089 __ret = (int32x2_t)(__p0);
5822958090 return __ret;
5823058091}
58231#else
58232__ai int16x8_t vpmaxq_s16(int16x8_t __p0, int16x8_t __p1) {
58233 int16x8_t __ret;
58234 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
58235 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
58236 __ret = (int16x8_t) __builtin_neon_vpmaxq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 33);
58237 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
58092__ai int32x2_t vreinterpret_s32_u16(uint16x4_t __p0) {
58093 int32x2_t __ret;
58094 __ret = (int32x2_t)(__p0);
5823858095 return __ret;
5823958096}
58240#endif
58241
58242#ifdef __LITTLE_ENDIAN__
58243__ai float64_t vpmaxqd_f64(float64x2_t __p0) {
58244 float64_t __ret;
58245 __ret = (float64_t) __builtin_neon_vpmaxqd_f64(__p0);
58097__ai int32x2_t vreinterpret_s32_s8(int8x8_t __p0) {
58098 int32x2_t __ret;
58099 __ret = (int32x2_t)(__p0);
5824658100 return __ret;
5824758101}
58248#else
58249__ai float64_t vpmaxqd_f64(float64x2_t __p0) {
58250 float64_t __ret;
58251 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
58252 __ret = (float64_t) __builtin_neon_vpmaxqd_f64(__rev0);
58102__ai int32x2_t vreinterpret_s32_f64(float64x1_t __p0) {
58103 int32x2_t __ret;
58104 __ret = (int32x2_t)(__p0);
5825358105 return __ret;
5825458106}
58255#endif
58256
58257#ifdef __LITTLE_ENDIAN__
58258__ai float32_t vpmaxs_f32(float32x2_t __p0) {
58259 float32_t __ret;
58260 __ret = (float32_t) __builtin_neon_vpmaxs_f32(__p0);
58107__ai int32x2_t vreinterpret_s32_f32(float32x2_t __p0) {
58108 int32x2_t __ret;
58109 __ret = (int32x2_t)(__p0);
5826158110 return __ret;
5826258111}
58263#else
58264__ai float32_t vpmaxs_f32(float32x2_t __p0) {
58265 float32_t __ret;
58266 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
58267 __ret = (float32_t) __builtin_neon_vpmaxs_f32(__rev0);
58112__ai int32x2_t vreinterpret_s32_f16(float16x4_t __p0) {
58113 int32x2_t __ret;
58114 __ret = (int32x2_t)(__p0);
5826858115 return __ret;
5826958116}
58270#endif
58271
58272#ifdef __LITTLE_ENDIAN__
58273__ai float64x2_t vpmaxnmq_f64(float64x2_t __p0, float64x2_t __p1) {
58274 float64x2_t __ret;
58275 __ret = (float64x2_t) __builtin_neon_vpmaxnmq_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
58117__ai int32x2_t vreinterpret_s32_s64(int64x1_t __p0) {
58118 int32x2_t __ret;
58119 __ret = (int32x2_t)(__p0);
5827658120 return __ret;
5827758121}
58278#else
58279__ai float64x2_t vpmaxnmq_f64(float64x2_t __p0, float64x2_t __p1) {
58280 float64x2_t __ret;
58281 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
58282 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
58283 __ret = (float64x2_t) __builtin_neon_vpmaxnmq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
58284 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
58122__ai int32x2_t vreinterpret_s32_s16(int16x4_t __p0) {
58123 int32x2_t __ret;
58124 __ret = (int32x2_t)(__p0);
5828558125 return __ret;
5828658126}
58287#endif
58288
58289#ifdef __LITTLE_ENDIAN__
58290__ai float32x4_t vpmaxnmq_f32(float32x4_t __p0, float32x4_t __p1) {
58291 float32x4_t __ret;
58292 __ret = (float32x4_t) __builtin_neon_vpmaxnmq_v((int8x16_t)__p0, (int8x16_t)__p1, 41);
58127__ai int64x1_t vreinterpret_s64_p8(poly8x8_t __p0) {
58128 int64x1_t __ret;
58129 __ret = (int64x1_t)(__p0);
5829358130 return __ret;
5829458131}
58295#else
58296__ai float32x4_t vpmaxnmq_f32(float32x4_t __p0, float32x4_t __p1) {
58297 float32x4_t __ret;
58298 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
58299 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
58300 __ret = (float32x4_t) __builtin_neon_vpmaxnmq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 41);
58301 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
58132__ai int64x1_t vreinterpret_s64_p64(poly64x1_t __p0) {
58133 int64x1_t __ret;
58134 __ret = (int64x1_t)(__p0);
5830258135 return __ret;
5830358136}
58304#endif
58305
58306#ifdef __LITTLE_ENDIAN__
58307__ai float32x2_t vpmaxnm_f32(float32x2_t __p0, float32x2_t __p1) {
58308 float32x2_t __ret;
58309 __ret = (float32x2_t) __builtin_neon_vpmaxnm_v((int8x8_t)__p0, (int8x8_t)__p1, 9);
58137__ai int64x1_t vreinterpret_s64_p16(poly16x4_t __p0) {
58138 int64x1_t __ret;
58139 __ret = (int64x1_t)(__p0);
5831058140 return __ret;
5831158141}
58312#else
58313__ai float32x2_t vpmaxnm_f32(float32x2_t __p0, float32x2_t __p1) {
58314 float32x2_t __ret;
58315 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
58316 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
58317 __ret = (float32x2_t) __builtin_neon_vpmaxnm_v((int8x8_t)__rev0, (int8x8_t)__rev1, 9);
58318 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
58142__ai int64x1_t vreinterpret_s64_u8(uint8x8_t __p0) {
58143 int64x1_t __ret;
58144 __ret = (int64x1_t)(__p0);
5831958145 return __ret;
5832058146}
58321#endif
58322
58323#ifdef __LITTLE_ENDIAN__
58324__ai float64_t vpmaxnmqd_f64(float64x2_t __p0) {
58325 float64_t __ret;
58326 __ret = (float64_t) __builtin_neon_vpmaxnmqd_f64(__p0);
58147__ai int64x1_t vreinterpret_s64_u32(uint32x2_t __p0) {
58148 int64x1_t __ret;
58149 __ret = (int64x1_t)(__p0);
5832758150 return __ret;
5832858151}
58329#else
58330__ai float64_t vpmaxnmqd_f64(float64x2_t __p0) {
58331 float64_t __ret;
58332 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
58333 __ret = (float64_t) __builtin_neon_vpmaxnmqd_f64(__rev0);
58152__ai int64x1_t vreinterpret_s64_u64(uint64x1_t __p0) {
58153 int64x1_t __ret;
58154 __ret = (int64x1_t)(__p0);
5833458155 return __ret;
5833558156}
58336#endif
58337
58338#ifdef __LITTLE_ENDIAN__
58339__ai float32_t vpmaxnms_f32(float32x2_t __p0) {
58340 float32_t __ret;
58341 __ret = (float32_t) __builtin_neon_vpmaxnms_f32(__p0);
58157__ai int64x1_t vreinterpret_s64_u16(uint16x4_t __p0) {
58158 int64x1_t __ret;
58159 __ret = (int64x1_t)(__p0);
5834258160 return __ret;
5834358161}
58344#else
58345__ai float32_t vpmaxnms_f32(float32x2_t __p0) {
58346 float32_t __ret;
58347 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
58348 __ret = (float32_t) __builtin_neon_vpmaxnms_f32(__rev0);
58162__ai int64x1_t vreinterpret_s64_s8(int8x8_t __p0) {
58163 int64x1_t __ret;
58164 __ret = (int64x1_t)(__p0);
5834958165 return __ret;
5835058166}
58351#endif
58352
58353#ifdef __LITTLE_ENDIAN__
58354__ai uint8x16_t vpminq_u8(uint8x16_t __p0, uint8x16_t __p1) {
58355 uint8x16_t __ret;
58356 __ret = (uint8x16_t) __builtin_neon_vpminq_v((int8x16_t)__p0, (int8x16_t)__p1, 48);
58167__ai int64x1_t vreinterpret_s64_f64(float64x1_t __p0) {
58168 int64x1_t __ret;
58169 __ret = (int64x1_t)(__p0);
5835758170 return __ret;
5835858171}
58359#else
58360__ai uint8x16_t vpminq_u8(uint8x16_t __p0, uint8x16_t __p1) {
58361 uint8x16_t __ret;
58362 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
58363 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
58364 __ret = (uint8x16_t) __builtin_neon_vpminq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 48);
58365 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
58172__ai int64x1_t vreinterpret_s64_f32(float32x2_t __p0) {
58173 int64x1_t __ret;
58174 __ret = (int64x1_t)(__p0);
5836658175 return __ret;
5836758176}
58368#endif
58369
58370#ifdef __LITTLE_ENDIAN__
58371__ai uint32x4_t vpminq_u32(uint32x4_t __p0, uint32x4_t __p1) {
58372 uint32x4_t __ret;
58373 __ret = (uint32x4_t) __builtin_neon_vpminq_v((int8x16_t)__p0, (int8x16_t)__p1, 50);
58177__ai int64x1_t vreinterpret_s64_f16(float16x4_t __p0) {
58178 int64x1_t __ret;
58179 __ret = (int64x1_t)(__p0);
5837458180 return __ret;
5837558181}
58376#else
58377__ai uint32x4_t vpminq_u32(uint32x4_t __p0, uint32x4_t __p1) {
58378 uint32x4_t __ret;
58379 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
58380 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
58381 __ret = (uint32x4_t) __builtin_neon_vpminq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 50);
58382 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
58182__ai int64x1_t vreinterpret_s64_s32(int32x2_t __p0) {
58183 int64x1_t __ret;
58184 __ret = (int64x1_t)(__p0);
5838358185 return __ret;
5838458186}
58385#endif
58386
58387#ifdef __LITTLE_ENDIAN__
58388__ai uint16x8_t vpminq_u16(uint16x8_t __p0, uint16x8_t __p1) {
58389 uint16x8_t __ret;
58390 __ret = (uint16x8_t) __builtin_neon_vpminq_v((int8x16_t)__p0, (int8x16_t)__p1, 49);
58187__ai int64x1_t vreinterpret_s64_s16(int16x4_t __p0) {
58188 int64x1_t __ret;
58189 __ret = (int64x1_t)(__p0);
5839158190 return __ret;
5839258191}
58393#else
58394__ai uint16x8_t vpminq_u16(uint16x8_t __p0, uint16x8_t __p1) {
58395 uint16x8_t __ret;
58396 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
58397 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
58398 __ret = (uint16x8_t) __builtin_neon_vpminq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 49);
58399 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
58192__ai int16x4_t vreinterpret_s16_p8(poly8x8_t __p0) {
58193 int16x4_t __ret;
58194 __ret = (int16x4_t)(__p0);
5840058195 return __ret;
5840158196}
58402#endif
58403
58404#ifdef __LITTLE_ENDIAN__
58405__ai int8x16_t vpminq_s8(int8x16_t __p0, int8x16_t __p1) {
58406 int8x16_t __ret;
58407 __ret = (int8x16_t) __builtin_neon_vpminq_v((int8x16_t)__p0, (int8x16_t)__p1, 32);
58197__ai int16x4_t vreinterpret_s16_p64(poly64x1_t __p0) {
58198 int16x4_t __ret;
58199 __ret = (int16x4_t)(__p0);
5840858200 return __ret;
5840958201}
58410#else
58411__ai int8x16_t vpminq_s8(int8x16_t __p0, int8x16_t __p1) {
58412 int8x16_t __ret;
58413 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
58414 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
58415 __ret = (int8x16_t) __builtin_neon_vpminq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 32);
58416 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
58202__ai int16x4_t vreinterpret_s16_p16(poly16x4_t __p0) {
58203 int16x4_t __ret;
58204 __ret = (int16x4_t)(__p0);
5841758205 return __ret;
5841858206}
58419#endif
58420
58421#ifdef __LITTLE_ENDIAN__
58422__ai float64x2_t vpminq_f64(float64x2_t __p0, float64x2_t __p1) {
58423 float64x2_t __ret;
58424 __ret = (float64x2_t) __builtin_neon_vpminq_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
58207__ai int16x4_t vreinterpret_s16_u8(uint8x8_t __p0) {
58208 int16x4_t __ret;
58209 __ret = (int16x4_t)(__p0);
5842558210 return __ret;
5842658211}
58427#else
58428__ai float64x2_t vpminq_f64(float64x2_t __p0, float64x2_t __p1) {
58429 float64x2_t __ret;
58430 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
58431 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
58432 __ret = (float64x2_t) __builtin_neon_vpminq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
58433 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
58212__ai int16x4_t vreinterpret_s16_u32(uint32x2_t __p0) {
58213 int16x4_t __ret;
58214 __ret = (int16x4_t)(__p0);
5843458215 return __ret;
5843558216}
58436#endif
58437
58438#ifdef __LITTLE_ENDIAN__
58439__ai float32x4_t vpminq_f32(float32x4_t __p0, float32x4_t __p1) {
58440 float32x4_t __ret;
58441 __ret = (float32x4_t) __builtin_neon_vpminq_v((int8x16_t)__p0, (int8x16_t)__p1, 41);
58217__ai int16x4_t vreinterpret_s16_u64(uint64x1_t __p0) {
58218 int16x4_t __ret;
58219 __ret = (int16x4_t)(__p0);
5844258220 return __ret;
5844358221}
58444#else
58445__ai float32x4_t vpminq_f32(float32x4_t __p0, float32x4_t __p1) {
58446 float32x4_t __ret;
58447 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
58448 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
58449 __ret = (float32x4_t) __builtin_neon_vpminq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 41);
58450 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
58222__ai int16x4_t vreinterpret_s16_u16(uint16x4_t __p0) {
58223 int16x4_t __ret;
58224 __ret = (int16x4_t)(__p0);
5845158225 return __ret;
5845258226}
58453#endif
58454
58455#ifdef __LITTLE_ENDIAN__
58456__ai int32x4_t vpminq_s32(int32x4_t __p0, int32x4_t __p1) {
58457 int32x4_t __ret;
58458 __ret = (int32x4_t) __builtin_neon_vpminq_v((int8x16_t)__p0, (int8x16_t)__p1, 34);
58227__ai int16x4_t vreinterpret_s16_s8(int8x8_t __p0) {
58228 int16x4_t __ret;
58229 __ret = (int16x4_t)(__p0);
5845958230 return __ret;
5846058231}
58461#else
58462__ai int32x4_t vpminq_s32(int32x4_t __p0, int32x4_t __p1) {
58463 int32x4_t __ret;
58464 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
58465 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
58466 __ret = (int32x4_t) __builtin_neon_vpminq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 34);
58467 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
58232__ai int16x4_t vreinterpret_s16_f64(float64x1_t __p0) {
58233 int16x4_t __ret;
58234 __ret = (int16x4_t)(__p0);
5846858235 return __ret;
5846958236}
58470#endif
58471
58472#ifdef __LITTLE_ENDIAN__
58473__ai int16x8_t vpminq_s16(int16x8_t __p0, int16x8_t __p1) {
58474 int16x8_t __ret;
58475 __ret = (int16x8_t) __builtin_neon_vpminq_v((int8x16_t)__p0, (int8x16_t)__p1, 33);
58237__ai int16x4_t vreinterpret_s16_f32(float32x2_t __p0) {
58238 int16x4_t __ret;
58239 __ret = (int16x4_t)(__p0);
5847658240 return __ret;
5847758241}
58478#else
58479__ai int16x8_t vpminq_s16(int16x8_t __p0, int16x8_t __p1) {
58480 int16x8_t __ret;
58481 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
58482 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
58483 __ret = (int16x8_t) __builtin_neon_vpminq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 33);
58484 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
58242__ai int16x4_t vreinterpret_s16_f16(float16x4_t __p0) {
58243 int16x4_t __ret;
58244 __ret = (int16x4_t)(__p0);
5848558245 return __ret;
5848658246}
58487#endif
58488
58489#ifdef __LITTLE_ENDIAN__
58490__ai float64_t vpminqd_f64(float64x2_t __p0) {
58491 float64_t __ret;
58492 __ret = (float64_t) __builtin_neon_vpminqd_f64(__p0);
58247__ai int16x4_t vreinterpret_s16_s32(int32x2_t __p0) {
58248 int16x4_t __ret;
58249 __ret = (int16x4_t)(__p0);
5849358250 return __ret;
5849458251}
58495#else
58496__ai float64_t vpminqd_f64(float64x2_t __p0) {
58497 float64_t __ret;
58498 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
58499 __ret = (float64_t) __builtin_neon_vpminqd_f64(__rev0);
58252__ai int16x4_t vreinterpret_s16_s64(int64x1_t __p0) {
58253 int16x4_t __ret;
58254 __ret = (int16x4_t)(__p0);
5850058255 return __ret;
5850158256}
58502#endif
58503
58504#ifdef __LITTLE_ENDIAN__
58505__ai float32_t vpmins_f32(float32x2_t __p0) {
58506 float32_t __ret;
58507 __ret = (float32_t) __builtin_neon_vpmins_f32(__p0);
58257__ai uint64_t vrshld_u64(uint64_t __p0, int64_t __p1) {
58258 uint64_t __ret;
58259 __ret = (uint64_t) __builtin_neon_vrshld_u64(__p0, __p1);
5850858260 return __ret;
5850958261}
58510#else
58511__ai float32_t vpmins_f32(float32x2_t __p0) {
58512 float32_t __ret;
58513 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
58514 __ret = (float32_t) __builtin_neon_vpmins_f32(__rev0);
58262__ai int64_t vrshld_s64(int64_t __p0, int64_t __p1) {
58263 int64_t __ret;
58264 __ret = (int64_t) __builtin_neon_vrshld_s64(__p0, __p1);
5851558265 return __ret;
5851658266}
58267#define vrshrd_n_u64(__p0, __p1) __extension__ ({ \
58268 uint64_t __ret; \
58269 uint64_t __s0 = __p0; \
58270 __ret = (uint64_t) __builtin_neon_vrshrd_n_u64(__s0, __p1); \
58271 __ret; \
58272})
58273#define vrshrd_n_s64(__p0, __p1) __extension__ ({ \
58274 int64_t __ret; \
58275 int64_t __s0 = __p0; \
58276 __ret = (int64_t) __builtin_neon_vrshrd_n_s64(__s0, __p1); \
58277 __ret; \
58278})
58279#ifdef __LITTLE_ENDIAN__
58280#define vrshrn_high_n_u32(__p0_703, __p1_703, __p2_703) __extension__ ({ \
58281 uint16x8_t __ret_703; \
58282 uint16x4_t __s0_703 = __p0_703; \
58283 uint32x4_t __s1_703 = __p1_703; \
58284 __ret_703 = (uint16x8_t)(vcombine_u16((uint16x4_t)(__s0_703), (uint16x4_t)(vrshrn_n_u32(__s1_703, __p2_703)))); \
58285 __ret_703; \
58286})
58287#else
58288#define vrshrn_high_n_u32(__p0_704, __p1_704, __p2_704) __extension__ ({ \
58289 uint16x8_t __ret_704; \
58290 uint16x4_t __s0_704 = __p0_704; \
58291 uint32x4_t __s1_704 = __p1_704; \
58292 uint16x4_t __rev0_704; __rev0_704 = __builtin_shufflevector(__s0_704, __s0_704, 3, 2, 1, 0); \
58293 uint32x4_t __rev1_704; __rev1_704 = __builtin_shufflevector(__s1_704, __s1_704, 3, 2, 1, 0); \
58294 __ret_704 = (uint16x8_t)(__noswap_vcombine_u16((uint16x4_t)(__rev0_704), (uint16x4_t)(__noswap_vrshrn_n_u32(__rev1_704, __p2_704)))); \
58295 __ret_704 = __builtin_shufflevector(__ret_704, __ret_704, 7, 6, 5, 4, 3, 2, 1, 0); \
58296 __ret_704; \
58297})
5851758298#endif
5851858299
5851958300#ifdef __LITTLE_ENDIAN__
58520__ai float64x2_t vpminnmq_f64(float64x2_t __p0, float64x2_t __p1) {
58521 float64x2_t __ret;
58522 __ret = (float64x2_t) __builtin_neon_vpminnmq_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
58523 return __ret;
58524}
58301#define vrshrn_high_n_u64(__p0_705, __p1_705, __p2_705) __extension__ ({ \
58302 uint32x4_t __ret_705; \
58303 uint32x2_t __s0_705 = __p0_705; \
58304 uint64x2_t __s1_705 = __p1_705; \
58305 __ret_705 = (uint32x4_t)(vcombine_u32((uint32x2_t)(__s0_705), (uint32x2_t)(vrshrn_n_u64(__s1_705, __p2_705)))); \
58306 __ret_705; \
58307})
5852558308#else
58526__ai float64x2_t vpminnmq_f64(float64x2_t __p0, float64x2_t __p1) {
58527 float64x2_t __ret;
58528 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
58529 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
58530 __ret = (float64x2_t) __builtin_neon_vpminnmq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
58531 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
58532 return __ret;
58533}
58309#define vrshrn_high_n_u64(__p0_706, __p1_706, __p2_706) __extension__ ({ \
58310 uint32x4_t __ret_706; \
58311 uint32x2_t __s0_706 = __p0_706; \
58312 uint64x2_t __s1_706 = __p1_706; \
58313 uint32x2_t __rev0_706; __rev0_706 = __builtin_shufflevector(__s0_706, __s0_706, 1, 0); \
58314 uint64x2_t __rev1_706; __rev1_706 = __builtin_shufflevector(__s1_706, __s1_706, 1, 0); \
58315 __ret_706 = (uint32x4_t)(__noswap_vcombine_u32((uint32x2_t)(__rev0_706), (uint32x2_t)(__noswap_vrshrn_n_u64(__rev1_706, __p2_706)))); \
58316 __ret_706 = __builtin_shufflevector(__ret_706, __ret_706, 3, 2, 1, 0); \
58317 __ret_706; \
58318})
5853458319#endif
5853558320
5853658321#ifdef __LITTLE_ENDIAN__
58537__ai float32x4_t vpminnmq_f32(float32x4_t __p0, float32x4_t __p1) {
58538 float32x4_t __ret;
58539 __ret = (float32x4_t) __builtin_neon_vpminnmq_v((int8x16_t)__p0, (int8x16_t)__p1, 41);
58540 return __ret;
58541}
58322#define vrshrn_high_n_u16(__p0_707, __p1_707, __p2_707) __extension__ ({ \
58323 uint8x16_t __ret_707; \
58324 uint8x8_t __s0_707 = __p0_707; \
58325 uint16x8_t __s1_707 = __p1_707; \
58326 __ret_707 = (uint8x16_t)(vcombine_u8((uint8x8_t)(__s0_707), (uint8x8_t)(vrshrn_n_u16(__s1_707, __p2_707)))); \
58327 __ret_707; \
58328})
5854258329#else
58543__ai float32x4_t vpminnmq_f32(float32x4_t __p0, float32x4_t __p1) {
58544 float32x4_t __ret;
58545 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
58546 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
58547 __ret = (float32x4_t) __builtin_neon_vpminnmq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 41);
58548 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
58549 return __ret;
58550}
58330#define vrshrn_high_n_u16(__p0_708, __p1_708, __p2_708) __extension__ ({ \
58331 uint8x16_t __ret_708; \
58332 uint8x8_t __s0_708 = __p0_708; \
58333 uint16x8_t __s1_708 = __p1_708; \
58334 uint8x8_t __rev0_708; __rev0_708 = __builtin_shufflevector(__s0_708, __s0_708, 7, 6, 5, 4, 3, 2, 1, 0); \
58335 uint16x8_t __rev1_708; __rev1_708 = __builtin_shufflevector(__s1_708, __s1_708, 7, 6, 5, 4, 3, 2, 1, 0); \
58336 __ret_708 = (uint8x16_t)(__noswap_vcombine_u8((uint8x8_t)(__rev0_708), (uint8x8_t)(__noswap_vrshrn_n_u16(__rev1_708, __p2_708)))); \
58337 __ret_708 = __builtin_shufflevector(__ret_708, __ret_708, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
58338 __ret_708; \
58339})
5855158340#endif
5855258341
5855358342#ifdef __LITTLE_ENDIAN__
58554__ai float32x2_t vpminnm_f32(float32x2_t __p0, float32x2_t __p1) {
58555 float32x2_t __ret;
58556 __ret = (float32x2_t) __builtin_neon_vpminnm_v((int8x8_t)__p0, (int8x8_t)__p1, 9);
58557 return __ret;
58558}
58343#define vrshrn_high_n_s32(__p0_709, __p1_709, __p2_709) __extension__ ({ \
58344 int16x8_t __ret_709; \
58345 int16x4_t __s0_709 = __p0_709; \
58346 int32x4_t __s1_709 = __p1_709; \
58347 __ret_709 = (int16x8_t)(vcombine_s16((int16x4_t)(__s0_709), (int16x4_t)(vrshrn_n_s32(__s1_709, __p2_709)))); \
58348 __ret_709; \
58349})
5855958350#else
58560__ai float32x2_t vpminnm_f32(float32x2_t __p0, float32x2_t __p1) {
58561 float32x2_t __ret;
58562 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
58563 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
58564 __ret = (float32x2_t) __builtin_neon_vpminnm_v((int8x8_t)__rev0, (int8x8_t)__rev1, 9);
58565 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
58566 return __ret;
58567}
58351#define vrshrn_high_n_s32(__p0_710, __p1_710, __p2_710) __extension__ ({ \
58352 int16x8_t __ret_710; \
58353 int16x4_t __s0_710 = __p0_710; \
58354 int32x4_t __s1_710 = __p1_710; \
58355 int16x4_t __rev0_710; __rev0_710 = __builtin_shufflevector(__s0_710, __s0_710, 3, 2, 1, 0); \
58356 int32x4_t __rev1_710; __rev1_710 = __builtin_shufflevector(__s1_710, __s1_710, 3, 2, 1, 0); \
58357 __ret_710 = (int16x8_t)(__noswap_vcombine_s16((int16x4_t)(__rev0_710), (int16x4_t)(__noswap_vrshrn_n_s32(__rev1_710, __p2_710)))); \
58358 __ret_710 = __builtin_shufflevector(__ret_710, __ret_710, 7, 6, 5, 4, 3, 2, 1, 0); \
58359 __ret_710; \
58360})
5856858361#endif
5856958362
5857058363#ifdef __LITTLE_ENDIAN__
58571__ai float64_t vpminnmqd_f64(float64x2_t __p0) {
58572 float64_t __ret;
58573 __ret = (float64_t) __builtin_neon_vpminnmqd_f64(__p0);
58574 return __ret;
58575}
58364#define vrshrn_high_n_s64(__p0_711, __p1_711, __p2_711) __extension__ ({ \
58365 int32x4_t __ret_711; \
58366 int32x2_t __s0_711 = __p0_711; \
58367 int64x2_t __s1_711 = __p1_711; \
58368 __ret_711 = (int32x4_t)(vcombine_s32((int32x2_t)(__s0_711), (int32x2_t)(vrshrn_n_s64(__s1_711, __p2_711)))); \
58369 __ret_711; \
58370})
5857658371#else
58577__ai float64_t vpminnmqd_f64(float64x2_t __p0) {
58578 float64_t __ret;
58579 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
58580 __ret = (float64_t) __builtin_neon_vpminnmqd_f64(__rev0);
58581 return __ret;
58582}
58372#define vrshrn_high_n_s64(__p0_712, __p1_712, __p2_712) __extension__ ({ \
58373 int32x4_t __ret_712; \
58374 int32x2_t __s0_712 = __p0_712; \
58375 int64x2_t __s1_712 = __p1_712; \
58376 int32x2_t __rev0_712; __rev0_712 = __builtin_shufflevector(__s0_712, __s0_712, 1, 0); \
58377 int64x2_t __rev1_712; __rev1_712 = __builtin_shufflevector(__s1_712, __s1_712, 1, 0); \
58378 __ret_712 = (int32x4_t)(__noswap_vcombine_s32((int32x2_t)(__rev0_712), (int32x2_t)(__noswap_vrshrn_n_s64(__rev1_712, __p2_712)))); \
58379 __ret_712 = __builtin_shufflevector(__ret_712, __ret_712, 3, 2, 1, 0); \
58380 __ret_712; \
58381})
5858358382#endif
5858458383
5858558384#ifdef __LITTLE_ENDIAN__
58586__ai float32_t vpminnms_f32(float32x2_t __p0) {
58587 float32_t __ret;
58588 __ret = (float32_t) __builtin_neon_vpminnms_f32(__p0);
58589 return __ret;
58590}
58385#define vrshrn_high_n_s16(__p0_713, __p1_713, __p2_713) __extension__ ({ \
58386 int8x16_t __ret_713; \
58387 int8x8_t __s0_713 = __p0_713; \
58388 int16x8_t __s1_713 = __p1_713; \
58389 __ret_713 = (int8x16_t)(vcombine_s8((int8x8_t)(__s0_713), (int8x8_t)(vrshrn_n_s16(__s1_713, __p2_713)))); \
58390 __ret_713; \
58391})
5859158392#else
58592__ai float32_t vpminnms_f32(float32x2_t __p0) {
58593 float32_t __ret;
58594 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
58595 __ret = (float32_t) __builtin_neon_vpminnms_f32(__rev0);
58596 return __ret;
58597}
58393#define vrshrn_high_n_s16(__p0_714, __p1_714, __p2_714) __extension__ ({ \
58394 int8x16_t __ret_714; \
58395 int8x8_t __s0_714 = __p0_714; \
58396 int16x8_t __s1_714 = __p1_714; \
58397 int8x8_t __rev0_714; __rev0_714 = __builtin_shufflevector(__s0_714, __s0_714, 7, 6, 5, 4, 3, 2, 1, 0); \
58398 int16x8_t __rev1_714; __rev1_714 = __builtin_shufflevector(__s1_714, __s1_714, 7, 6, 5, 4, 3, 2, 1, 0); \
58399 __ret_714 = (int8x16_t)(__noswap_vcombine_s8((int8x8_t)(__rev0_714), (int8x8_t)(__noswap_vrshrn_n_s16(__rev1_714, __p2_714)))); \
58400 __ret_714 = __builtin_shufflevector(__ret_714, __ret_714, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
58401 __ret_714; \
58402})
5859858403#endif
5859958404
5860058405#ifdef __LITTLE_ENDIAN__
58601__ai int64x2_t vqabsq_s64(int64x2_t __p0) {
58602 int64x2_t __ret;
58603 __ret = (int64x2_t) __builtin_neon_vqabsq_v((int8x16_t)__p0, 35);
58406__ai float64x2_t vrsqrteq_f64(float64x2_t __p0) {
58407 float64x2_t __ret;
58408 __ret = (float64x2_t) __builtin_neon_vrsqrteq_v((int8x16_t)__p0, 42);
5860458409 return __ret;
5860558410}
5860658411#else
58607__ai int64x2_t vqabsq_s64(int64x2_t __p0) {
58608 int64x2_t __ret;
58609 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
58610 __ret = (int64x2_t) __builtin_neon_vqabsq_v((int8x16_t)__rev0, 35);
58412__ai float64x2_t vrsqrteq_f64(float64x2_t __p0) {
58413 float64x2_t __ret;
58414 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
58415 __ret = (float64x2_t) __builtin_neon_vrsqrteq_v((int8x16_t)__rev0, 42);
5861158416 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
5861258417 return __ret;
5861358418}
5861458419#endif
5861558420
58616__ai int64x1_t vqabs_s64(int64x1_t __p0) {
58617 int64x1_t __ret;
58618 __ret = (int64x1_t) __builtin_neon_vqabs_v((int8x8_t)__p0, 3);
58619 return __ret;
58620}
58621__ai int8_t vqabsb_s8(int8_t __p0) {
58622 int8_t __ret;
58623 __ret = (int8_t) __builtin_neon_vqabsb_s8(__p0);
58421__ai float64x1_t vrsqrte_f64(float64x1_t __p0) {
58422 float64x1_t __ret;
58423 __ret = (float64x1_t) __builtin_neon_vrsqrte_v((int8x8_t)__p0, 10);
5862458424 return __ret;
5862558425}
58626__ai int32_t vqabss_s32(int32_t __p0) {
58627 int32_t __ret;
58628 __ret = (int32_t) __builtin_neon_vqabss_s32(__p0);
58426__ai float64_t vrsqrted_f64(float64_t __p0) {
58427 float64_t __ret;
58428 __ret = (float64_t) __builtin_neon_vrsqrted_f64(__p0);
5862958429 return __ret;
5863058430}
58631__ai int64_t vqabsd_s64(int64_t __p0) {
58632 int64_t __ret;
58633 __ret = (int64_t) __builtin_neon_vqabsd_s64(__p0);
58431__ai float32_t vrsqrtes_f32(float32_t __p0) {
58432 float32_t __ret;
58433 __ret = (float32_t) __builtin_neon_vrsqrtes_f32(__p0);
5863458434 return __ret;
5863558435}
58636__ai int16_t vqabsh_s16(int16_t __p0) {
58637 int16_t __ret;
58638 __ret = (int16_t) __builtin_neon_vqabsh_s16(__p0);
58436#ifdef __LITTLE_ENDIAN__
58437__ai float64x2_t vrsqrtsq_f64(float64x2_t __p0, float64x2_t __p1) {
58438 float64x2_t __ret;
58439 __ret = (float64x2_t) __builtin_neon_vrsqrtsq_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
5863958440 return __ret;
5864058441}
58641__ai uint8_t vqaddb_u8(uint8_t __p0, uint8_t __p1) {
58642 uint8_t __ret;
58643 __ret = (uint8_t) __builtin_neon_vqaddb_u8(__p0, __p1);
58442#else
58443__ai float64x2_t vrsqrtsq_f64(float64x2_t __p0, float64x2_t __p1) {
58444 float64x2_t __ret;
58445 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
58446 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
58447 __ret = (float64x2_t) __builtin_neon_vrsqrtsq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
58448 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
5864458449 return __ret;
5864558450}
58646__ai uint32_t vqadds_u32(uint32_t __p0, uint32_t __p1) {
58647 uint32_t __ret;
58648 __ret = (uint32_t) __builtin_neon_vqadds_u32(__p0, __p1);
58451#endif
58452
58453__ai float64x1_t vrsqrts_f64(float64x1_t __p0, float64x1_t __p1) {
58454 float64x1_t __ret;
58455 __ret = (float64x1_t) __builtin_neon_vrsqrts_v((int8x8_t)__p0, (int8x8_t)__p1, 10);
5864958456 return __ret;
5865058457}
58651__ai uint64_t vqaddd_u64(uint64_t __p0, uint64_t __p1) {
58652 uint64_t __ret;
58653 __ret = (uint64_t) __builtin_neon_vqaddd_u64(__p0, __p1);
58458__ai float64_t vrsqrtsd_f64(float64_t __p0, float64_t __p1) {
58459 float64_t __ret;
58460 __ret = (float64_t) __builtin_neon_vrsqrtsd_f64(__p0, __p1);
5865458461 return __ret;
5865558462}
58656__ai uint16_t vqaddh_u16(uint16_t __p0, uint16_t __p1) {
58657 uint16_t __ret;
58658 __ret = (uint16_t) __builtin_neon_vqaddh_u16(__p0, __p1);
58463__ai float32_t vrsqrtss_f32(float32_t __p0, float32_t __p1) {
58464 float32_t __ret;
58465 __ret = (float32_t) __builtin_neon_vrsqrtss_f32(__p0, __p1);
5865958466 return __ret;
5866058467}
58661__ai int8_t vqaddb_s8(int8_t __p0, int8_t __p1) {
58662 int8_t __ret;
58663 __ret = (int8_t) __builtin_neon_vqaddb_s8(__p0, __p1);
58468#define vrsrad_n_u64(__p0, __p1, __p2) __extension__ ({ \
58469 uint64_t __ret; \
58470 uint64_t __s0 = __p0; \
58471 uint64_t __s1 = __p1; \
58472 __ret = (uint64_t) __builtin_neon_vrsrad_n_u64(__s0, __s1, __p2); \
58473 __ret; \
58474})
58475#define vrsrad_n_s64(__p0, __p1, __p2) __extension__ ({ \
58476 int64_t __ret; \
58477 int64_t __s0 = __p0; \
58478 int64_t __s1 = __p1; \
58479 __ret = (int64_t) __builtin_neon_vrsrad_n_s64(__s0, __s1, __p2); \
58480 __ret; \
58481})
58482#ifdef __LITTLE_ENDIAN__
58483__ai uint16x8_t vrsubhn_high_u32(uint16x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
58484 uint16x8_t __ret;
58485 __ret = vcombine_u16(__p0, vrsubhn_u32(__p1, __p2));
5866458486 return __ret;
5866558487}
58666__ai int32_t vqadds_s32(int32_t __p0, int32_t __p1) {
58667 int32_t __ret;
58668 __ret = (int32_t) __builtin_neon_vqadds_s32(__p0, __p1);
58488#else
58489__ai uint16x8_t vrsubhn_high_u32(uint16x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
58490 uint16x8_t __ret;
58491 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
58492 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
58493 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
58494 __ret = __noswap_vcombine_u16(__rev0, __noswap_vrsubhn_u32(__rev1, __rev2));
58495 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
5866958496 return __ret;
5867058497}
58671__ai int64_t vqaddd_s64(int64_t __p0, int64_t __p1) {
58672 int64_t __ret;
58673 __ret = (int64_t) __builtin_neon_vqaddd_s64(__p0, __p1);
58498#endif
58499
58500#ifdef __LITTLE_ENDIAN__
58501__ai uint32x4_t vrsubhn_high_u64(uint32x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
58502 uint32x4_t __ret;
58503 __ret = vcombine_u32(__p0, vrsubhn_u64(__p1, __p2));
5867458504 return __ret;
5867558505}
58676__ai int16_t vqaddh_s16(int16_t __p0, int16_t __p1) {
58677 int16_t __ret;
58678 __ret = (int16_t) __builtin_neon_vqaddh_s16(__p0, __p1);
58506#else
58507__ai uint32x4_t vrsubhn_high_u64(uint32x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
58508 uint32x4_t __ret;
58509 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
58510 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
58511 uint64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
58512 __ret = __noswap_vcombine_u32(__rev0, __noswap_vrsubhn_u64(__rev1, __rev2));
58513 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
5867958514 return __ret;
5868058515}
58681__ai int64_t vqdmlals_s32(int64_t __p0, int32_t __p1, int32_t __p2) {
58682 int64_t __ret;
58683 __ret = (int64_t) __builtin_neon_vqdmlals_s32(__p0, __p1, __p2);
58516#endif
58517
58518#ifdef __LITTLE_ENDIAN__
58519__ai uint8x16_t vrsubhn_high_u16(uint8x8_t __p0, uint16x8_t __p1, uint16x8_t __p2) {
58520 uint8x16_t __ret;
58521 __ret = vcombine_u8(__p0, vrsubhn_u16(__p1, __p2));
5868458522 return __ret;
5868558523}
58686__ai int32_t vqdmlalh_s16(int32_t __p0, int16_t __p1, int16_t __p2) {
58687 int32_t __ret;
58688 __ret = (int32_t) __builtin_neon_vqdmlalh_s16(__p0, __p1, __p2);
58524#else
58525__ai uint8x16_t vrsubhn_high_u16(uint8x8_t __p0, uint16x8_t __p1, uint16x8_t __p2) {
58526 uint8x16_t __ret;
58527 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
58528 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
58529 uint16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
58530 __ret = __noswap_vcombine_u8(__rev0, __noswap_vrsubhn_u16(__rev1, __rev2));
58531 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
5868958532 return __ret;
5869058533}
58534#endif
58535
5869158536#ifdef __LITTLE_ENDIAN__
58692__ai int64x2_t vqdmlal_high_s32(int64x2_t __p0, int32x4_t __p1, int32x4_t __p2) {
58693 int64x2_t __ret;
58694 __ret = vqdmlal_s32(__p0, vget_high_s32(__p1), vget_high_s32(__p2));
58537__ai int16x8_t vrsubhn_high_s32(int16x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
58538 int16x8_t __ret;
58539 __ret = vcombine_s16(__p0, vrsubhn_s32(__p1, __p2));
5869558540 return __ret;
5869658541}
5869758542#else
58698__ai int64x2_t vqdmlal_high_s32(int64x2_t __p0, int32x4_t __p1, int32x4_t __p2) {
58699 int64x2_t __ret;
58700 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
58543__ai int16x8_t vrsubhn_high_s32(int16x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
58544 int16x8_t __ret;
58545 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
5870158546 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
5870258547 int32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
58703 __ret = __noswap_vqdmlal_s32(__rev0, __noswap_vget_high_s32(__rev1), __noswap_vget_high_s32(__rev2));
58704 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
58548 __ret = __noswap_vcombine_s16(__rev0, __noswap_vrsubhn_s32(__rev1, __rev2));
58549 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
5870558550 return __ret;
5870658551}
5870758552#endif
5870858553
5870958554#ifdef __LITTLE_ENDIAN__
58710__ai int32x4_t vqdmlal_high_s16(int32x4_t __p0, int16x8_t __p1, int16x8_t __p2) {
58555__ai int32x4_t vrsubhn_high_s64(int32x2_t __p0, int64x2_t __p1, int64x2_t __p2) {
5871158556 int32x4_t __ret;
58712 __ret = vqdmlal_s16(__p0, vget_high_s16(__p1), vget_high_s16(__p2));
58557 __ret = vcombine_s32(__p0, vrsubhn_s64(__p1, __p2));
5871358558 return __ret;
5871458559}
5871558560#else
58716__ai int32x4_t vqdmlal_high_s16(int32x4_t __p0, int16x8_t __p1, int16x8_t __p2) {
58561__ai int32x4_t vrsubhn_high_s64(int32x2_t __p0, int64x2_t __p1, int64x2_t __p2) {
5871758562 int32x4_t __ret;
58718 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
58563 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
58564 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
58565 int64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
58566 __ret = __noswap_vcombine_s32(__rev0, __noswap_vrsubhn_s64(__rev1, __rev2));
58567 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
58568 return __ret;
58569}
58570#endif
58571
58572#ifdef __LITTLE_ENDIAN__
58573__ai int8x16_t vrsubhn_high_s16(int8x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
58574 int8x16_t __ret;
58575 __ret = vcombine_s8(__p0, vrsubhn_s16(__p1, __p2));
58576 return __ret;
58577}
58578#else
58579__ai int8x16_t vrsubhn_high_s16(int8x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
58580 int8x16_t __ret;
58581 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
5871958582 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
5872058583 int16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
58721 __ret = __noswap_vqdmlal_s16(__rev0, __noswap_vget_high_s16(__rev1), __noswap_vget_high_s16(__rev2));
58722 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
58584 __ret = __noswap_vcombine_s8(__rev0, __noswap_vrsubhn_s16(__rev1, __rev2));
58585 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
5872358586 return __ret;
5872458587}
5872558588#endif
5872658589
58590#define vset_lane_p64(__p0, __p1, __p2) __extension__ ({ \
58591 poly64x1_t __ret; \
58592 poly64_t __s0 = __p0; \
58593 poly64x1_t __s1 = __p1; \
58594 __ret = (poly64x1_t) __builtin_neon_vset_lane_i64(__s0, (poly64x1_t)__s1, __p2); \
58595 __ret; \
58596})
5872758597#ifdef __LITTLE_ENDIAN__
58728#define vqdmlal_high_lane_s32(__p0_711, __p1_711, __p2_711, __p3_711) __extension__ ({ \
58729 int64x2_t __ret_711; \
58730 int64x2_t __s0_711 = __p0_711; \
58731 int32x4_t __s1_711 = __p1_711; \
58732 int32x2_t __s2_711 = __p2_711; \
58733 __ret_711 = vqdmlal_s32(__s0_711, vget_high_s32(__s1_711), splat_lane_s32(__s2_711, __p3_711)); \
58734 __ret_711; \
58598#define vsetq_lane_p64(__p0, __p1, __p2) __extension__ ({ \
58599 poly64x2_t __ret; \
58600 poly64_t __s0 = __p0; \
58601 poly64x2_t __s1 = __p1; \
58602 __ret = (poly64x2_t) __builtin_neon_vsetq_lane_i64(__s0, (poly64x2_t)__s1, __p2); \
58603 __ret; \
5873558604})
5873658605#else
58737#define vqdmlal_high_lane_s32(__p0_712, __p1_712, __p2_712, __p3_712) __extension__ ({ \
58738 int64x2_t __ret_712; \
58739 int64x2_t __s0_712 = __p0_712; \
58740 int32x4_t __s1_712 = __p1_712; \
58741 int32x2_t __s2_712 = __p2_712; \
58742 int64x2_t __rev0_712; __rev0_712 = __builtin_shufflevector(__s0_712, __s0_712, 1, 0); \
58743 int32x4_t __rev1_712; __rev1_712 = __builtin_shufflevector(__s1_712, __s1_712, 3, 2, 1, 0); \
58744 int32x2_t __rev2_712; __rev2_712 = __builtin_shufflevector(__s2_712, __s2_712, 1, 0); \
58745 __ret_712 = __noswap_vqdmlal_s32(__rev0_712, __noswap_vget_high_s32(__rev1_712), __noswap_splat_lane_s32(__rev2_712, __p3_712)); \
58746 __ret_712 = __builtin_shufflevector(__ret_712, __ret_712, 1, 0); \
58747 __ret_712; \
58606#define vsetq_lane_p64(__p0, __p1, __p2) __extension__ ({ \
58607 poly64x2_t __ret; \
58608 poly64_t __s0 = __p0; \
58609 poly64x2_t __s1 = __p1; \
58610 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
58611 __ret = (poly64x2_t) __builtin_neon_vsetq_lane_i64(__s0, (poly64x2_t)__rev1, __p2); \
58612 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
58613 __ret; \
58614})
58615#define __noswap_vsetq_lane_p64(__p0, __p1, __p2) __extension__ ({ \
58616 poly64x2_t __ret; \
58617 poly64_t __s0 = __p0; \
58618 poly64x2_t __s1 = __p1; \
58619 __ret = (poly64x2_t) __builtin_neon_vsetq_lane_i64(__s0, (poly64x2_t)__s1, __p2); \
58620 __ret; \
5874858621})
5874958622#endif
5875058623
5875158624#ifdef __LITTLE_ENDIAN__
58752#define vqdmlal_high_lane_s16(__p0_713, __p1_713, __p2_713, __p3_713) __extension__ ({ \
58753 int32x4_t __ret_713; \
58754 int32x4_t __s0_713 = __p0_713; \
58755 int16x8_t __s1_713 = __p1_713; \
58756 int16x4_t __s2_713 = __p2_713; \
58757 __ret_713 = vqdmlal_s16(__s0_713, vget_high_s16(__s1_713), splat_lane_s16(__s2_713, __p3_713)); \
58758 __ret_713; \
58625#define vsetq_lane_f64(__p0, __p1, __p2) __extension__ ({ \
58626 float64x2_t __ret; \
58627 float64_t __s0 = __p0; \
58628 float64x2_t __s1 = __p1; \
58629 __ret = (float64x2_t) __builtin_neon_vsetq_lane_f64(__s0, (float64x2_t)__s1, __p2); \
58630 __ret; \
5875958631})
5876058632#else
58761#define vqdmlal_high_lane_s16(__p0_714, __p1_714, __p2_714, __p3_714) __extension__ ({ \
58762 int32x4_t __ret_714; \
58763 int32x4_t __s0_714 = __p0_714; \
58764 int16x8_t __s1_714 = __p1_714; \
58765 int16x4_t __s2_714 = __p2_714; \
58766 int32x4_t __rev0_714; __rev0_714 = __builtin_shufflevector(__s0_714, __s0_714, 3, 2, 1, 0); \
58767 int16x8_t __rev1_714; __rev1_714 = __builtin_shufflevector(__s1_714, __s1_714, 7, 6, 5, 4, 3, 2, 1, 0); \
58768 int16x4_t __rev2_714; __rev2_714 = __builtin_shufflevector(__s2_714, __s2_714, 3, 2, 1, 0); \
58769 __ret_714 = __noswap_vqdmlal_s16(__rev0_714, __noswap_vget_high_s16(__rev1_714), __noswap_splat_lane_s16(__rev2_714, __p3_714)); \
58770 __ret_714 = __builtin_shufflevector(__ret_714, __ret_714, 3, 2, 1, 0); \
58771 __ret_714; \
58633#define vsetq_lane_f64(__p0, __p1, __p2) __extension__ ({ \
58634 float64x2_t __ret; \
58635 float64_t __s0 = __p0; \
58636 float64x2_t __s1 = __p1; \
58637 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
58638 __ret = (float64x2_t) __builtin_neon_vsetq_lane_f64(__s0, (float64x2_t)__rev1, __p2); \
58639 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
58640 __ret; \
58641})
58642#define __noswap_vsetq_lane_f64(__p0, __p1, __p2) __extension__ ({ \
58643 float64x2_t __ret; \
58644 float64_t __s0 = __p0; \
58645 float64x2_t __s1 = __p1; \
58646 __ret = (float64x2_t) __builtin_neon_vsetq_lane_f64(__s0, (float64x2_t)__s1, __p2); \
58647 __ret; \
5877258648})
5877358649#endif
5877458650
58651#define vset_lane_f64(__p0, __p1, __p2) __extension__ ({ \
58652 float64x1_t __ret; \
58653 float64_t __s0 = __p0; \
58654 float64x1_t __s1 = __p1; \
58655 __ret = (float64x1_t) __builtin_neon_vset_lane_f64(__s0, (float64x1_t)__s1, __p2); \
58656 __ret; \
58657})
58658__ai uint64_t vshld_u64(uint64_t __p0, int64_t __p1) {
58659 uint64_t __ret;
58660 __ret = (uint64_t) __builtin_neon_vshld_u64(__p0, __p1);
58661 return __ret;
58662}
58663__ai int64_t vshld_s64(int64_t __p0, int64_t __p1) {
58664 int64_t __ret;
58665 __ret = (int64_t) __builtin_neon_vshld_s64(__p0, __p1);
58666 return __ret;
58667}
58668#define vshld_n_u64(__p0, __p1) __extension__ ({ \
58669 uint64_t __ret; \
58670 uint64_t __s0 = __p0; \
58671 __ret = (uint64_t) __builtin_neon_vshld_n_u64(__s0, __p1); \
58672 __ret; \
58673})
58674#define vshld_n_s64(__p0, __p1) __extension__ ({ \
58675 int64_t __ret; \
58676 int64_t __s0 = __p0; \
58677 __ret = (int64_t) __builtin_neon_vshld_n_s64(__s0, __p1); \
58678 __ret; \
58679})
5877558680#ifdef __LITTLE_ENDIAN__
58776#define vqdmlal_high_laneq_s32(__p0_715, __p1_715, __p2_715, __p3_715) __extension__ ({ \
58777 int64x2_t __ret_715; \
58778 int64x2_t __s0_715 = __p0_715; \
58779 int32x4_t __s1_715 = __p1_715; \
58780 int32x4_t __s2_715 = __p2_715; \
58781 __ret_715 = vqdmlal_s32(__s0_715, vget_high_s32(__s1_715), splat_laneq_s32(__s2_715, __p3_715)); \
58681#define vshll_high_n_u8(__p0_715, __p1_715) __extension__ ({ \
58682 uint16x8_t __ret_715; \
58683 uint8x16_t __s0_715 = __p0_715; \
58684 __ret_715 = (uint16x8_t)(vshll_n_u8(vget_high_u8(__s0_715), __p1_715)); \
5878258685 __ret_715; \
5878358686})
5878458687#else
58785#define vqdmlal_high_laneq_s32(__p0_716, __p1_716, __p2_716, __p3_716) __extension__ ({ \
58786 int64x2_t __ret_716; \
58787 int64x2_t __s0_716 = __p0_716; \
58788 int32x4_t __s1_716 = __p1_716; \
58789 int32x4_t __s2_716 = __p2_716; \
58790 int64x2_t __rev0_716; __rev0_716 = __builtin_shufflevector(__s0_716, __s0_716, 1, 0); \
58791 int32x4_t __rev1_716; __rev1_716 = __builtin_shufflevector(__s1_716, __s1_716, 3, 2, 1, 0); \
58792 int32x4_t __rev2_716; __rev2_716 = __builtin_shufflevector(__s2_716, __s2_716, 3, 2, 1, 0); \
58793 __ret_716 = __noswap_vqdmlal_s32(__rev0_716, __noswap_vget_high_s32(__rev1_716), __noswap_splat_laneq_s32(__rev2_716, __p3_716)); \
58794 __ret_716 = __builtin_shufflevector(__ret_716, __ret_716, 1, 0); \
58688#define vshll_high_n_u8(__p0_716, __p1_716) __extension__ ({ \
58689 uint16x8_t __ret_716; \
58690 uint8x16_t __s0_716 = __p0_716; \
58691 uint8x16_t __rev0_716; __rev0_716 = __builtin_shufflevector(__s0_716, __s0_716, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
58692 __ret_716 = (uint16x8_t)(__noswap_vshll_n_u8(__noswap_vget_high_u8(__rev0_716), __p1_716)); \
58693 __ret_716 = __builtin_shufflevector(__ret_716, __ret_716, 7, 6, 5, 4, 3, 2, 1, 0); \
5879558694 __ret_716; \
5879658695})
5879758696#endif
5879858697
5879958698#ifdef __LITTLE_ENDIAN__
58800#define vqdmlal_high_laneq_s16(__p0_717, __p1_717, __p2_717, __p3_717) __extension__ ({ \
58801 int32x4_t __ret_717; \
58802 int32x4_t __s0_717 = __p0_717; \
58803 int16x8_t __s1_717 = __p1_717; \
58804 int16x8_t __s2_717 = __p2_717; \
58805 __ret_717 = vqdmlal_s16(__s0_717, vget_high_s16(__s1_717), splat_laneq_s16(__s2_717, __p3_717)); \
58699#define vshll_high_n_u32(__p0_717, __p1_717) __extension__ ({ \
58700 uint64x2_t __ret_717; \
58701 uint32x4_t __s0_717 = __p0_717; \
58702 __ret_717 = (uint64x2_t)(vshll_n_u32(vget_high_u32(__s0_717), __p1_717)); \
5880658703 __ret_717; \
5880758704})
5880858705#else
58809#define vqdmlal_high_laneq_s16(__p0_718, __p1_718, __p2_718, __p3_718) __extension__ ({ \
58810 int32x4_t __ret_718; \
58811 int32x4_t __s0_718 = __p0_718; \
58812 int16x8_t __s1_718 = __p1_718; \
58813 int16x8_t __s2_718 = __p2_718; \
58814 int32x4_t __rev0_718; __rev0_718 = __builtin_shufflevector(__s0_718, __s0_718, 3, 2, 1, 0); \
58815 int16x8_t __rev1_718; __rev1_718 = __builtin_shufflevector(__s1_718, __s1_718, 7, 6, 5, 4, 3, 2, 1, 0); \
58816 int16x8_t __rev2_718; __rev2_718 = __builtin_shufflevector(__s2_718, __s2_718, 7, 6, 5, 4, 3, 2, 1, 0); \
58817 __ret_718 = __noswap_vqdmlal_s16(__rev0_718, __noswap_vget_high_s16(__rev1_718), __noswap_splat_laneq_s16(__rev2_718, __p3_718)); \
58818 __ret_718 = __builtin_shufflevector(__ret_718, __ret_718, 3, 2, 1, 0); \
58706#define vshll_high_n_u32(__p0_718, __p1_718) __extension__ ({ \
58707 uint64x2_t __ret_718; \
58708 uint32x4_t __s0_718 = __p0_718; \
58709 uint32x4_t __rev0_718; __rev0_718 = __builtin_shufflevector(__s0_718, __s0_718, 3, 2, 1, 0); \
58710 __ret_718 = (uint64x2_t)(__noswap_vshll_n_u32(__noswap_vget_high_u32(__rev0_718), __p1_718)); \
58711 __ret_718 = __builtin_shufflevector(__ret_718, __ret_718, 1, 0); \
5881958712 __ret_718; \
5882058713})
5882158714#endif
5882258715
5882358716#ifdef __LITTLE_ENDIAN__
58824__ai int64x2_t vqdmlal_high_n_s32(int64x2_t __p0, int32x4_t __p1, int32_t __p2) {
58825 int64x2_t __ret;
58826 __ret = vqdmlal_n_s32(__p0, vget_high_s32(__p1), __p2);
58827 return __ret;
58828}
58717#define vshll_high_n_u16(__p0_719, __p1_719) __extension__ ({ \
58718 uint32x4_t __ret_719; \
58719 uint16x8_t __s0_719 = __p0_719; \
58720 __ret_719 = (uint32x4_t)(vshll_n_u16(vget_high_u16(__s0_719), __p1_719)); \
58721 __ret_719; \
58722})
5882958723#else
58830__ai int64x2_t vqdmlal_high_n_s32(int64x2_t __p0, int32x4_t __p1, int32_t __p2) {
58831 int64x2_t __ret;
58832 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
58833 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
58834 __ret = __noswap_vqdmlal_n_s32(__rev0, __noswap_vget_high_s32(__rev1), __p2);
58835 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
58836 return __ret;
58837}
58724#define vshll_high_n_u16(__p0_720, __p1_720) __extension__ ({ \
58725 uint32x4_t __ret_720; \
58726 uint16x8_t __s0_720 = __p0_720; \
58727 uint16x8_t __rev0_720; __rev0_720 = __builtin_shufflevector(__s0_720, __s0_720, 7, 6, 5, 4, 3, 2, 1, 0); \
58728 __ret_720 = (uint32x4_t)(__noswap_vshll_n_u16(__noswap_vget_high_u16(__rev0_720), __p1_720)); \
58729 __ret_720 = __builtin_shufflevector(__ret_720, __ret_720, 3, 2, 1, 0); \
58730 __ret_720; \
58731})
5883858732#endif
5883958733
5884058734#ifdef __LITTLE_ENDIAN__
58841__ai int32x4_t vqdmlal_high_n_s16(int32x4_t __p0, int16x8_t __p1, int16_t __p2) {
58842 int32x4_t __ret;
58843 __ret = vqdmlal_n_s16(__p0, vget_high_s16(__p1), __p2);
58844 return __ret;
58845}
58735#define vshll_high_n_s8(__p0_721, __p1_721) __extension__ ({ \
58736 int16x8_t __ret_721; \
58737 int8x16_t __s0_721 = __p0_721; \
58738 __ret_721 = (int16x8_t)(vshll_n_s8(vget_high_s8(__s0_721), __p1_721)); \
58739 __ret_721; \
58740})
5884658741#else
58847__ai int32x4_t vqdmlal_high_n_s16(int32x4_t __p0, int16x8_t __p1, int16_t __p2) {
58848 int32x4_t __ret;
58849 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
58850 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
58851 __ret = __noswap_vqdmlal_n_s16(__rev0, __noswap_vget_high_s16(__rev1), __p2);
58852 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
58853 return __ret;
58854}
58742#define vshll_high_n_s8(__p0_722, __p1_722) __extension__ ({ \
58743 int16x8_t __ret_722; \
58744 int8x16_t __s0_722 = __p0_722; \
58745 int8x16_t __rev0_722; __rev0_722 = __builtin_shufflevector(__s0_722, __s0_722, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
58746 __ret_722 = (int16x8_t)(__noswap_vshll_n_s8(__noswap_vget_high_s8(__rev0_722), __p1_722)); \
58747 __ret_722 = __builtin_shufflevector(__ret_722, __ret_722, 7, 6, 5, 4, 3, 2, 1, 0); \
58748 __ret_722; \
58749})
5885558750#endif
5885658751
5885758752#ifdef __LITTLE_ENDIAN__
58858#define vqdmlals_lane_s32(__p0, __p1, __p2, __p3) __extension__ ({ \
58859 int64_t __ret; \
58860 int64_t __s0 = __p0; \
58861 int32_t __s1 = __p1; \
58862 int32x2_t __s2 = __p2; \
58863 __ret = (int64_t) __builtin_neon_vqdmlals_lane_s32(__s0, __s1, __s2, __p3); \
58864 __ret; \
58753#define vshll_high_n_s32(__p0_723, __p1_723) __extension__ ({ \
58754 int64x2_t __ret_723; \
58755 int32x4_t __s0_723 = __p0_723; \
58756 __ret_723 = (int64x2_t)(vshll_n_s32(vget_high_s32(__s0_723), __p1_723)); \
58757 __ret_723; \
5886558758})
5886658759#else
58867#define vqdmlals_lane_s32(__p0, __p1, __p2, __p3) __extension__ ({ \
58760#define vshll_high_n_s32(__p0_724, __p1_724) __extension__ ({ \
58761 int64x2_t __ret_724; \
58762 int32x4_t __s0_724 = __p0_724; \
58763 int32x4_t __rev0_724; __rev0_724 = __builtin_shufflevector(__s0_724, __s0_724, 3, 2, 1, 0); \
58764 __ret_724 = (int64x2_t)(__noswap_vshll_n_s32(__noswap_vget_high_s32(__rev0_724), __p1_724)); \
58765 __ret_724 = __builtin_shufflevector(__ret_724, __ret_724, 1, 0); \
58766 __ret_724; \
58767})
58768#endif
58769
58770#ifdef __LITTLE_ENDIAN__
58771#define vshll_high_n_s16(__p0_725, __p1_725) __extension__ ({ \
58772 int32x4_t __ret_725; \
58773 int16x8_t __s0_725 = __p0_725; \
58774 __ret_725 = (int32x4_t)(vshll_n_s16(vget_high_s16(__s0_725), __p1_725)); \
58775 __ret_725; \
58776})
58777#else
58778#define vshll_high_n_s16(__p0_726, __p1_726) __extension__ ({ \
58779 int32x4_t __ret_726; \
58780 int16x8_t __s0_726 = __p0_726; \
58781 int16x8_t __rev0_726; __rev0_726 = __builtin_shufflevector(__s0_726, __s0_726, 7, 6, 5, 4, 3, 2, 1, 0); \
58782 __ret_726 = (int32x4_t)(__noswap_vshll_n_s16(__noswap_vget_high_s16(__rev0_726), __p1_726)); \
58783 __ret_726 = __builtin_shufflevector(__ret_726, __ret_726, 3, 2, 1, 0); \
58784 __ret_726; \
58785})
58786#endif
58787
58788#define vshrd_n_u64(__p0, __p1) __extension__ ({ \
58789 uint64_t __ret; \
58790 uint64_t __s0 = __p0; \
58791 __ret = (uint64_t) __builtin_neon_vshrd_n_u64(__s0, __p1); \
58792 __ret; \
58793})
58794#define vshrd_n_s64(__p0, __p1) __extension__ ({ \
5886858795 int64_t __ret; \
5886958796 int64_t __s0 = __p0; \
58870 int32_t __s1 = __p1; \
58871 int32x2_t __s2 = __p2; \
58872 int32x2_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 1, 0); \
58873 __ret = (int64_t) __builtin_neon_vqdmlals_lane_s32(__s0, __s1, __rev2, __p3); \
58797 __ret = (int64_t) __builtin_neon_vshrd_n_s64(__s0, __p1); \
5887458798 __ret; \
5887558799})
58800#ifdef __LITTLE_ENDIAN__
58801#define vshrn_high_n_u32(__p0_727, __p1_727, __p2_727) __extension__ ({ \
58802 uint16x8_t __ret_727; \
58803 uint16x4_t __s0_727 = __p0_727; \
58804 uint32x4_t __s1_727 = __p1_727; \
58805 __ret_727 = (uint16x8_t)(vcombine_u16((uint16x4_t)(__s0_727), (uint16x4_t)(vshrn_n_u32(__s1_727, __p2_727)))); \
58806 __ret_727; \
58807})
58808#else
58809#define vshrn_high_n_u32(__p0_728, __p1_728, __p2_728) __extension__ ({ \
58810 uint16x8_t __ret_728; \
58811 uint16x4_t __s0_728 = __p0_728; \
58812 uint32x4_t __s1_728 = __p1_728; \
58813 uint16x4_t __rev0_728; __rev0_728 = __builtin_shufflevector(__s0_728, __s0_728, 3, 2, 1, 0); \
58814 uint32x4_t __rev1_728; __rev1_728 = __builtin_shufflevector(__s1_728, __s1_728, 3, 2, 1, 0); \
58815 __ret_728 = (uint16x8_t)(__noswap_vcombine_u16((uint16x4_t)(__rev0_728), (uint16x4_t)(__noswap_vshrn_n_u32(__rev1_728, __p2_728)))); \
58816 __ret_728 = __builtin_shufflevector(__ret_728, __ret_728, 7, 6, 5, 4, 3, 2, 1, 0); \
58817 __ret_728; \
58818})
5887658819#endif
5887758820
5887858821#ifdef __LITTLE_ENDIAN__
58879#define vqdmlalh_lane_s16(__p0, __p1, __p2, __p3) __extension__ ({ \
58880 int32_t __ret; \
58881 int32_t __s0 = __p0; \
58882 int16_t __s1 = __p1; \
58883 int16x4_t __s2 = __p2; \
58884 __ret = (int32_t) __builtin_neon_vqdmlalh_lane_s16(__s0, __s1, __s2, __p3); \
58885 __ret; \
58822#define vshrn_high_n_u64(__p0_729, __p1_729, __p2_729) __extension__ ({ \
58823 uint32x4_t __ret_729; \
58824 uint32x2_t __s0_729 = __p0_729; \
58825 uint64x2_t __s1_729 = __p1_729; \
58826 __ret_729 = (uint32x4_t)(vcombine_u32((uint32x2_t)(__s0_729), (uint32x2_t)(vshrn_n_u64(__s1_729, __p2_729)))); \
58827 __ret_729; \
5888658828})
5888758829#else
58888#define vqdmlalh_lane_s16(__p0, __p1, __p2, __p3) __extension__ ({ \
58889 int32_t __ret; \
58890 int32_t __s0 = __p0; \
58891 int16_t __s1 = __p1; \
58892 int16x4_t __s2 = __p2; \
58893 int16x4_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 3, 2, 1, 0); \
58894 __ret = (int32_t) __builtin_neon_vqdmlalh_lane_s16(__s0, __s1, __rev2, __p3); \
58895 __ret; \
58830#define vshrn_high_n_u64(__p0_730, __p1_730, __p2_730) __extension__ ({ \
58831 uint32x4_t __ret_730; \
58832 uint32x2_t __s0_730 = __p0_730; \
58833 uint64x2_t __s1_730 = __p1_730; \
58834 uint32x2_t __rev0_730; __rev0_730 = __builtin_shufflevector(__s0_730, __s0_730, 1, 0); \
58835 uint64x2_t __rev1_730; __rev1_730 = __builtin_shufflevector(__s1_730, __s1_730, 1, 0); \
58836 __ret_730 = (uint32x4_t)(__noswap_vcombine_u32((uint32x2_t)(__rev0_730), (uint32x2_t)(__noswap_vshrn_n_u64(__rev1_730, __p2_730)))); \
58837 __ret_730 = __builtin_shufflevector(__ret_730, __ret_730, 3, 2, 1, 0); \
58838 __ret_730; \
5889658839})
5889758840#endif
5889858841
5889958842#ifdef __LITTLE_ENDIAN__
58900#define vqdmlals_laneq_s32(__p0, __p1, __p2, __p3) __extension__ ({ \
58901 int64_t __ret; \
58902 int64_t __s0 = __p0; \
58903 int32_t __s1 = __p1; \
58904 int32x4_t __s2 = __p2; \
58905 __ret = (int64_t) __builtin_neon_vqdmlals_laneq_s32(__s0, __s1, __s2, __p3); \
58906 __ret; \
58843#define vshrn_high_n_u16(__p0_731, __p1_731, __p2_731) __extension__ ({ \
58844 uint8x16_t __ret_731; \
58845 uint8x8_t __s0_731 = __p0_731; \
58846 uint16x8_t __s1_731 = __p1_731; \
58847 __ret_731 = (uint8x16_t)(vcombine_u8((uint8x8_t)(__s0_731), (uint8x8_t)(vshrn_n_u16(__s1_731, __p2_731)))); \
58848 __ret_731; \
5890758849})
5890858850#else
58909#define vqdmlals_laneq_s32(__p0, __p1, __p2, __p3) __extension__ ({ \
58910 int64_t __ret; \
58911 int64_t __s0 = __p0; \
58912 int32_t __s1 = __p1; \
58913 int32x4_t __s2 = __p2; \
58914 int32x4_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 3, 2, 1, 0); \
58915 __ret = (int64_t) __builtin_neon_vqdmlals_laneq_s32(__s0, __s1, __rev2, __p3); \
58916 __ret; \
58851#define vshrn_high_n_u16(__p0_732, __p1_732, __p2_732) __extension__ ({ \
58852 uint8x16_t __ret_732; \
58853 uint8x8_t __s0_732 = __p0_732; \
58854 uint16x8_t __s1_732 = __p1_732; \
58855 uint8x8_t __rev0_732; __rev0_732 = __builtin_shufflevector(__s0_732, __s0_732, 7, 6, 5, 4, 3, 2, 1, 0); \
58856 uint16x8_t __rev1_732; __rev1_732 = __builtin_shufflevector(__s1_732, __s1_732, 7, 6, 5, 4, 3, 2, 1, 0); \
58857 __ret_732 = (uint8x16_t)(__noswap_vcombine_u8((uint8x8_t)(__rev0_732), (uint8x8_t)(__noswap_vshrn_n_u16(__rev1_732, __p2_732)))); \
58858 __ret_732 = __builtin_shufflevector(__ret_732, __ret_732, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
58859 __ret_732; \
5891758860})
5891858861#endif
5891958862
5892058863#ifdef __LITTLE_ENDIAN__
58921#define vqdmlalh_laneq_s16(__p0, __p1, __p2, __p3) __extension__ ({ \
58922 int32_t __ret; \
58923 int32_t __s0 = __p0; \
58924 int16_t __s1 = __p1; \
58925 int16x8_t __s2 = __p2; \
58926 __ret = (int32_t) __builtin_neon_vqdmlalh_laneq_s16(__s0, __s1, __s2, __p3); \
58927 __ret; \
58864#define vshrn_high_n_s32(__p0_733, __p1_733, __p2_733) __extension__ ({ \
58865 int16x8_t __ret_733; \
58866 int16x4_t __s0_733 = __p0_733; \
58867 int32x4_t __s1_733 = __p1_733; \
58868 __ret_733 = (int16x8_t)(vcombine_s16((int16x4_t)(__s0_733), (int16x4_t)(vshrn_n_s32(__s1_733, __p2_733)))); \
58869 __ret_733; \
5892858870})
5892958871#else
58930#define vqdmlalh_laneq_s16(__p0, __p1, __p2, __p3) __extension__ ({ \
58931 int32_t __ret; \
58932 int32_t __s0 = __p0; \
58933 int16_t __s1 = __p1; \
58934 int16x8_t __s2 = __p2; \
58935 int16x8_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 7, 6, 5, 4, 3, 2, 1, 0); \
58936 __ret = (int32_t) __builtin_neon_vqdmlalh_laneq_s16(__s0, __s1, __rev2, __p3); \
58937 __ret; \
58872#define vshrn_high_n_s32(__p0_734, __p1_734, __p2_734) __extension__ ({ \
58873 int16x8_t __ret_734; \
58874 int16x4_t __s0_734 = __p0_734; \
58875 int32x4_t __s1_734 = __p1_734; \
58876 int16x4_t __rev0_734; __rev0_734 = __builtin_shufflevector(__s0_734, __s0_734, 3, 2, 1, 0); \
58877 int32x4_t __rev1_734; __rev1_734 = __builtin_shufflevector(__s1_734, __s1_734, 3, 2, 1, 0); \
58878 __ret_734 = (int16x8_t)(__noswap_vcombine_s16((int16x4_t)(__rev0_734), (int16x4_t)(__noswap_vshrn_n_s32(__rev1_734, __p2_734)))); \
58879 __ret_734 = __builtin_shufflevector(__ret_734, __ret_734, 7, 6, 5, 4, 3, 2, 1, 0); \
58880 __ret_734; \
5893858881})
5893958882#endif
5894058883
5894158884#ifdef __LITTLE_ENDIAN__
58942#define vqdmlal_laneq_s32(__p0_719, __p1_719, __p2_719, __p3_719) __extension__ ({ \
58943 int64x2_t __ret_719; \
58944 int64x2_t __s0_719 = __p0_719; \
58945 int32x2_t __s1_719 = __p1_719; \
58946 int32x4_t __s2_719 = __p2_719; \
58947 __ret_719 = vqdmlal_s32(__s0_719, __s1_719, splat_laneq_s32(__s2_719, __p3_719)); \
58948 __ret_719; \
58885#define vshrn_high_n_s64(__p0_735, __p1_735, __p2_735) __extension__ ({ \
58886 int32x4_t __ret_735; \
58887 int32x2_t __s0_735 = __p0_735; \
58888 int64x2_t __s1_735 = __p1_735; \
58889 __ret_735 = (int32x4_t)(vcombine_s32((int32x2_t)(__s0_735), (int32x2_t)(vshrn_n_s64(__s1_735, __p2_735)))); \
58890 __ret_735; \
5894958891})
5895058892#else
58951#define vqdmlal_laneq_s32(__p0_720, __p1_720, __p2_720, __p3_720) __extension__ ({ \
58952 int64x2_t __ret_720; \
58953 int64x2_t __s0_720 = __p0_720; \
58954 int32x2_t __s1_720 = __p1_720; \
58955 int32x4_t __s2_720 = __p2_720; \
58956 int64x2_t __rev0_720; __rev0_720 = __builtin_shufflevector(__s0_720, __s0_720, 1, 0); \
58957 int32x2_t __rev1_720; __rev1_720 = __builtin_shufflevector(__s1_720, __s1_720, 1, 0); \
58958 int32x4_t __rev2_720; __rev2_720 = __builtin_shufflevector(__s2_720, __s2_720, 3, 2, 1, 0); \
58959 __ret_720 = __noswap_vqdmlal_s32(__rev0_720, __rev1_720, __noswap_splat_laneq_s32(__rev2_720, __p3_720)); \
58960 __ret_720 = __builtin_shufflevector(__ret_720, __ret_720, 1, 0); \
58961 __ret_720; \
58893#define vshrn_high_n_s64(__p0_736, __p1_736, __p2_736) __extension__ ({ \
58894 int32x4_t __ret_736; \
58895 int32x2_t __s0_736 = __p0_736; \
58896 int64x2_t __s1_736 = __p1_736; \
58897 int32x2_t __rev0_736; __rev0_736 = __builtin_shufflevector(__s0_736, __s0_736, 1, 0); \
58898 int64x2_t __rev1_736; __rev1_736 = __builtin_shufflevector(__s1_736, __s1_736, 1, 0); \
58899 __ret_736 = (int32x4_t)(__noswap_vcombine_s32((int32x2_t)(__rev0_736), (int32x2_t)(__noswap_vshrn_n_s64(__rev1_736, __p2_736)))); \
58900 __ret_736 = __builtin_shufflevector(__ret_736, __ret_736, 3, 2, 1, 0); \
58901 __ret_736; \
5896258902})
5896358903#endif
5896458904
5896558905#ifdef __LITTLE_ENDIAN__
58966#define vqdmlal_laneq_s16(__p0_721, __p1_721, __p2_721, __p3_721) __extension__ ({ \
58967 int32x4_t __ret_721; \
58968 int32x4_t __s0_721 = __p0_721; \
58969 int16x4_t __s1_721 = __p1_721; \
58970 int16x8_t __s2_721 = __p2_721; \
58971 __ret_721 = vqdmlal_s16(__s0_721, __s1_721, splat_laneq_s16(__s2_721, __p3_721)); \
58972 __ret_721; \
58906#define vshrn_high_n_s16(__p0_737, __p1_737, __p2_737) __extension__ ({ \
58907 int8x16_t __ret_737; \
58908 int8x8_t __s0_737 = __p0_737; \
58909 int16x8_t __s1_737 = __p1_737; \
58910 __ret_737 = (int8x16_t)(vcombine_s8((int8x8_t)(__s0_737), (int8x8_t)(vshrn_n_s16(__s1_737, __p2_737)))); \
58911 __ret_737; \
5897358912})
5897458913#else
58975#define vqdmlal_laneq_s16(__p0_722, __p1_722, __p2_722, __p3_722) __extension__ ({ \
58976 int32x4_t __ret_722; \
58977 int32x4_t __s0_722 = __p0_722; \
58978 int16x4_t __s1_722 = __p1_722; \
58979 int16x8_t __s2_722 = __p2_722; \
58980 int32x4_t __rev0_722; __rev0_722 = __builtin_shufflevector(__s0_722, __s0_722, 3, 2, 1, 0); \
58981 int16x4_t __rev1_722; __rev1_722 = __builtin_shufflevector(__s1_722, __s1_722, 3, 2, 1, 0); \
58982 int16x8_t __rev2_722; __rev2_722 = __builtin_shufflevector(__s2_722, __s2_722, 7, 6, 5, 4, 3, 2, 1, 0); \
58983 __ret_722 = __noswap_vqdmlal_s16(__rev0_722, __rev1_722, __noswap_splat_laneq_s16(__rev2_722, __p3_722)); \
58984 __ret_722 = __builtin_shufflevector(__ret_722, __ret_722, 3, 2, 1, 0); \
58985 __ret_722; \
58914#define vshrn_high_n_s16(__p0_738, __p1_738, __p2_738) __extension__ ({ \
58915 int8x16_t __ret_738; \
58916 int8x8_t __s0_738 = __p0_738; \
58917 int16x8_t __s1_738 = __p1_738; \
58918 int8x8_t __rev0_738; __rev0_738 = __builtin_shufflevector(__s0_738, __s0_738, 7, 6, 5, 4, 3, 2, 1, 0); \
58919 int16x8_t __rev1_738; __rev1_738 = __builtin_shufflevector(__s1_738, __s1_738, 7, 6, 5, 4, 3, 2, 1, 0); \
58920 __ret_738 = (int8x16_t)(__noswap_vcombine_s8((int8x8_t)(__rev0_738), (int8x8_t)(__noswap_vshrn_n_s16(__rev1_738, __p2_738)))); \
58921 __ret_738 = __builtin_shufflevector(__ret_738, __ret_738, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
58922 __ret_738; \
5898658923})
5898758924#endif
5898858925
58989__ai int64_t vqdmlsls_s32(int64_t __p0, int32_t __p1, int32_t __p2) {
58990 int64_t __ret;
58991 __ret = (int64_t) __builtin_neon_vqdmlsls_s32(__p0, __p1, __p2);
58926#define vslid_n_u64(__p0, __p1, __p2) __extension__ ({ \
58927 uint64_t __ret; \
58928 uint64_t __s0 = __p0; \
58929 uint64_t __s1 = __p1; \
58930 __ret = (uint64_t) __builtin_neon_vslid_n_u64(__s0, __s1, __p2); \
58931 __ret; \
58932})
58933#define vslid_n_s64(__p0, __p1, __p2) __extension__ ({ \
58934 int64_t __ret; \
58935 int64_t __s0 = __p0; \
58936 int64_t __s1 = __p1; \
58937 __ret = (int64_t) __builtin_neon_vslid_n_s64(__s0, __s1, __p2); \
58938 __ret; \
58939})
58940#define vsli_n_p64(__p0, __p1, __p2) __extension__ ({ \
58941 poly64x1_t __ret; \
58942 poly64x1_t __s0 = __p0; \
58943 poly64x1_t __s1 = __p1; \
58944 __ret = (poly64x1_t) __builtin_neon_vsli_n_v((int8x8_t)__s0, (int8x8_t)__s1, __p2, 6); \
58945 __ret; \
58946})
58947#ifdef __LITTLE_ENDIAN__
58948#define vsliq_n_p64(__p0, __p1, __p2) __extension__ ({ \
58949 poly64x2_t __ret; \
58950 poly64x2_t __s0 = __p0; \
58951 poly64x2_t __s1 = __p1; \
58952 __ret = (poly64x2_t) __builtin_neon_vsliq_n_v((int8x16_t)__s0, (int8x16_t)__s1, __p2, 38); \
58953 __ret; \
58954})
58955#else
58956#define vsliq_n_p64(__p0, __p1, __p2) __extension__ ({ \
58957 poly64x2_t __ret; \
58958 poly64x2_t __s0 = __p0; \
58959 poly64x2_t __s1 = __p1; \
58960 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
58961 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
58962 __ret = (poly64x2_t) __builtin_neon_vsliq_n_v((int8x16_t)__rev0, (int8x16_t)__rev1, __p2, 38); \
58963 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
58964 __ret; \
58965})
58966#endif
58967
58968__ai uint8_t vsqaddb_u8(uint8_t __p0, int8_t __p1) {
58969 uint8_t __ret;
58970 __ret = (uint8_t) __builtin_neon_vsqaddb_u8(__p0, __p1);
5899258971 return __ret;
5899358972}
58994__ai int32_t vqdmlslh_s16(int32_t __p0, int16_t __p1, int16_t __p2) {
58995 int32_t __ret;
58996 __ret = (int32_t) __builtin_neon_vqdmlslh_s16(__p0, __p1, __p2);
58973__ai uint32_t vsqadds_u32(uint32_t __p0, int32_t __p1) {
58974 uint32_t __ret;
58975 __ret = (uint32_t) __builtin_neon_vsqadds_u32(__p0, __p1);
58976 return __ret;
58977}
58978__ai uint64_t vsqaddd_u64(uint64_t __p0, int64_t __p1) {
58979 uint64_t __ret;
58980 __ret = (uint64_t) __builtin_neon_vsqaddd_u64(__p0, __p1);
58981 return __ret;
58982}
58983__ai uint16_t vsqaddh_u16(uint16_t __p0, int16_t __p1) {
58984 uint16_t __ret;
58985 __ret = (uint16_t) __builtin_neon_vsqaddh_u16(__p0, __p1);
5899758986 return __ret;
5899858987}
5899958988#ifdef __LITTLE_ENDIAN__
59000__ai int64x2_t vqdmlsl_high_s32(int64x2_t __p0, int32x4_t __p1, int32x4_t __p2) {
59001 int64x2_t __ret;
59002 __ret = vqdmlsl_s32(__p0, vget_high_s32(__p1), vget_high_s32(__p2));
58989__ai uint8x16_t vsqaddq_u8(uint8x16_t __p0, int8x16_t __p1) {
58990 uint8x16_t __ret;
58991 __ret = (uint8x16_t) __builtin_neon_vsqaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 48);
5900358992 return __ret;
5900458993}
5900558994#else
59006__ai int64x2_t vqdmlsl_high_s32(int64x2_t __p0, int32x4_t __p1, int32x4_t __p2) {
59007 int64x2_t __ret;
59008 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
59009 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
59010 int32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
59011 __ret = __noswap_vqdmlsl_s32(__rev0, __noswap_vget_high_s32(__rev1), __noswap_vget_high_s32(__rev2));
59012 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
58995__ai uint8x16_t vsqaddq_u8(uint8x16_t __p0, int8x16_t __p1) {
58996 uint8x16_t __ret;
58997 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
58998 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
58999 __ret = (uint8x16_t) __builtin_neon_vsqaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 48);
59000 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
5901359001 return __ret;
5901459002}
5901559003#endif
5901659004
5901759005#ifdef __LITTLE_ENDIAN__
59018__ai int32x4_t vqdmlsl_high_s16(int32x4_t __p0, int16x8_t __p1, int16x8_t __p2) {
59019 int32x4_t __ret;
59020 __ret = vqdmlsl_s16(__p0, vget_high_s16(__p1), vget_high_s16(__p2));
59006__ai uint32x4_t vsqaddq_u32(uint32x4_t __p0, int32x4_t __p1) {
59007 uint32x4_t __ret;
59008 __ret = (uint32x4_t) __builtin_neon_vsqaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 50);
5902159009 return __ret;
5902259010}
5902359011#else
59024__ai int32x4_t vqdmlsl_high_s16(int32x4_t __p0, int16x8_t __p1, int16x8_t __p2) {
59025 int32x4_t __ret;
59026 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
59027 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
59028 int16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
59029 __ret = __noswap_vqdmlsl_s16(__rev0, __noswap_vget_high_s16(__rev1), __noswap_vget_high_s16(__rev2));
59012__ai uint32x4_t vsqaddq_u32(uint32x4_t __p0, int32x4_t __p1) {
59013 uint32x4_t __ret;
59014 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
59015 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
59016 __ret = (uint32x4_t) __builtin_neon_vsqaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 50);
5903059017 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
5903159018 return __ret;
5903259019}
5903359020#endif
5903459021
5903559022#ifdef __LITTLE_ENDIAN__
59036#define vqdmlsl_high_lane_s32(__p0_723, __p1_723, __p2_723, __p3_723) __extension__ ({ \
59037 int64x2_t __ret_723; \
59038 int64x2_t __s0_723 = __p0_723; \
59039 int32x4_t __s1_723 = __p1_723; \
59040 int32x2_t __s2_723 = __p2_723; \
59041 __ret_723 = vqdmlsl_s32(__s0_723, vget_high_s32(__s1_723), splat_lane_s32(__s2_723, __p3_723)); \
59042 __ret_723; \
59043})
59023__ai uint64x2_t vsqaddq_u64(uint64x2_t __p0, int64x2_t __p1) {
59024 uint64x2_t __ret;
59025 __ret = (uint64x2_t) __builtin_neon_vsqaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 51);
59026 return __ret;
59027}
5904459028#else
59045#define vqdmlsl_high_lane_s32(__p0_724, __p1_724, __p2_724, __p3_724) __extension__ ({ \
59046 int64x2_t __ret_724; \
59047 int64x2_t __s0_724 = __p0_724; \
59048 int32x4_t __s1_724 = __p1_724; \
59049 int32x2_t __s2_724 = __p2_724; \
59050 int64x2_t __rev0_724; __rev0_724 = __builtin_shufflevector(__s0_724, __s0_724, 1, 0); \
59051 int32x4_t __rev1_724; __rev1_724 = __builtin_shufflevector(__s1_724, __s1_724, 3, 2, 1, 0); \
59052 int32x2_t __rev2_724; __rev2_724 = __builtin_shufflevector(__s2_724, __s2_724, 1, 0); \
59053 __ret_724 = __noswap_vqdmlsl_s32(__rev0_724, __noswap_vget_high_s32(__rev1_724), __noswap_splat_lane_s32(__rev2_724, __p3_724)); \
59054 __ret_724 = __builtin_shufflevector(__ret_724, __ret_724, 1, 0); \
59055 __ret_724; \
59056})
59029__ai uint64x2_t vsqaddq_u64(uint64x2_t __p0, int64x2_t __p1) {
59030 uint64x2_t __ret;
59031 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
59032 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
59033 __ret = (uint64x2_t) __builtin_neon_vsqaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 51);
59034 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
59035 return __ret;
59036}
5905759037#endif
5905859038
5905959039#ifdef __LITTLE_ENDIAN__
59060#define vqdmlsl_high_lane_s16(__p0_725, __p1_725, __p2_725, __p3_725) __extension__ ({ \
59061 int32x4_t __ret_725; \
59062 int32x4_t __s0_725 = __p0_725; \
59063 int16x8_t __s1_725 = __p1_725; \
59064 int16x4_t __s2_725 = __p2_725; \
59065 __ret_725 = vqdmlsl_s16(__s0_725, vget_high_s16(__s1_725), splat_lane_s16(__s2_725, __p3_725)); \
59066 __ret_725; \
59067})
59040__ai uint16x8_t vsqaddq_u16(uint16x8_t __p0, int16x8_t __p1) {
59041 uint16x8_t __ret;
59042 __ret = (uint16x8_t) __builtin_neon_vsqaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 49);
59043 return __ret;
59044}
5906859045#else
59069#define vqdmlsl_high_lane_s16(__p0_726, __p1_726, __p2_726, __p3_726) __extension__ ({ \
59070 int32x4_t __ret_726; \
59071 int32x4_t __s0_726 = __p0_726; \
59072 int16x8_t __s1_726 = __p1_726; \
59073 int16x4_t __s2_726 = __p2_726; \
59074 int32x4_t __rev0_726; __rev0_726 = __builtin_shufflevector(__s0_726, __s0_726, 3, 2, 1, 0); \
59075 int16x8_t __rev1_726; __rev1_726 = __builtin_shufflevector(__s1_726, __s1_726, 7, 6, 5, 4, 3, 2, 1, 0); \
59076 int16x4_t __rev2_726; __rev2_726 = __builtin_shufflevector(__s2_726, __s2_726, 3, 2, 1, 0); \
59077 __ret_726 = __noswap_vqdmlsl_s16(__rev0_726, __noswap_vget_high_s16(__rev1_726), __noswap_splat_lane_s16(__rev2_726, __p3_726)); \
59078 __ret_726 = __builtin_shufflevector(__ret_726, __ret_726, 3, 2, 1, 0); \
59079 __ret_726; \
59080})
59046__ai uint16x8_t vsqaddq_u16(uint16x8_t __p0, int16x8_t __p1) {
59047 uint16x8_t __ret;
59048 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
59049 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
59050 __ret = (uint16x8_t) __builtin_neon_vsqaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 49);
59051 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
59052 return __ret;
59053}
59054#endif
59055
59056#ifdef __LITTLE_ENDIAN__
59057__ai uint8x8_t vsqadd_u8(uint8x8_t __p0, int8x8_t __p1) {
59058 uint8x8_t __ret;
59059 __ret = (uint8x8_t) __builtin_neon_vsqadd_v((int8x8_t)__p0, (int8x8_t)__p1, 16);
59060 return __ret;
59061}
59062#else
59063__ai uint8x8_t vsqadd_u8(uint8x8_t __p0, int8x8_t __p1) {
59064 uint8x8_t __ret;
59065 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
59066 int8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
59067 __ret = (uint8x8_t) __builtin_neon_vsqadd_v((int8x8_t)__rev0, (int8x8_t)__rev1, 16);
59068 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
59069 return __ret;
59070}
5908159071#endif
5908259072
5908359073#ifdef __LITTLE_ENDIAN__
59084#define vqdmlsl_high_laneq_s32(__p0_727, __p1_727, __p2_727, __p3_727) __extension__ ({ \
59085 int64x2_t __ret_727; \
59086 int64x2_t __s0_727 = __p0_727; \
59087 int32x4_t __s1_727 = __p1_727; \
59088 int32x4_t __s2_727 = __p2_727; \
59089 __ret_727 = vqdmlsl_s32(__s0_727, vget_high_s32(__s1_727), splat_laneq_s32(__s2_727, __p3_727)); \
59090 __ret_727; \
59091})
59074__ai uint32x2_t vsqadd_u32(uint32x2_t __p0, int32x2_t __p1) {
59075 uint32x2_t __ret;
59076 __ret = (uint32x2_t) __builtin_neon_vsqadd_v((int8x8_t)__p0, (int8x8_t)__p1, 18);
59077 return __ret;
59078}
5909259079#else
59093#define vqdmlsl_high_laneq_s32(__p0_728, __p1_728, __p2_728, __p3_728) __extension__ ({ \
59094 int64x2_t __ret_728; \
59095 int64x2_t __s0_728 = __p0_728; \
59096 int32x4_t __s1_728 = __p1_728; \
59097 int32x4_t __s2_728 = __p2_728; \
59098 int64x2_t __rev0_728; __rev0_728 = __builtin_shufflevector(__s0_728, __s0_728, 1, 0); \
59099 int32x4_t __rev1_728; __rev1_728 = __builtin_shufflevector(__s1_728, __s1_728, 3, 2, 1, 0); \
59100 int32x4_t __rev2_728; __rev2_728 = __builtin_shufflevector(__s2_728, __s2_728, 3, 2, 1, 0); \
59101 __ret_728 = __noswap_vqdmlsl_s32(__rev0_728, __noswap_vget_high_s32(__rev1_728), __noswap_splat_laneq_s32(__rev2_728, __p3_728)); \
59102 __ret_728 = __builtin_shufflevector(__ret_728, __ret_728, 1, 0); \
59103 __ret_728; \
59104})
59080__ai uint32x2_t vsqadd_u32(uint32x2_t __p0, int32x2_t __p1) {
59081 uint32x2_t __ret;
59082 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
59083 int32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
59084 __ret = (uint32x2_t) __builtin_neon_vsqadd_v((int8x8_t)__rev0, (int8x8_t)__rev1, 18);
59085 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
59086 return __ret;
59087}
5910559088#endif
5910659089
59090__ai uint64x1_t vsqadd_u64(uint64x1_t __p0, int64x1_t __p1) {
59091 uint64x1_t __ret;
59092 __ret = (uint64x1_t) __builtin_neon_vsqadd_v((int8x8_t)__p0, (int8x8_t)__p1, 19);
59093 return __ret;
59094}
5910759095#ifdef __LITTLE_ENDIAN__
59108#define vqdmlsl_high_laneq_s16(__p0_729, __p1_729, __p2_729, __p3_729) __extension__ ({ \
59109 int32x4_t __ret_729; \
59110 int32x4_t __s0_729 = __p0_729; \
59111 int16x8_t __s1_729 = __p1_729; \
59112 int16x8_t __s2_729 = __p2_729; \
59113 __ret_729 = vqdmlsl_s16(__s0_729, vget_high_s16(__s1_729), splat_laneq_s16(__s2_729, __p3_729)); \
59114 __ret_729; \
59115})
59096__ai uint16x4_t vsqadd_u16(uint16x4_t __p0, int16x4_t __p1) {
59097 uint16x4_t __ret;
59098 __ret = (uint16x4_t) __builtin_neon_vsqadd_v((int8x8_t)__p0, (int8x8_t)__p1, 17);
59099 return __ret;
59100}
5911659101#else
59117#define vqdmlsl_high_laneq_s16(__p0_730, __p1_730, __p2_730, __p3_730) __extension__ ({ \
59118 int32x4_t __ret_730; \
59119 int32x4_t __s0_730 = __p0_730; \
59120 int16x8_t __s1_730 = __p1_730; \
59121 int16x8_t __s2_730 = __p2_730; \
59122 int32x4_t __rev0_730; __rev0_730 = __builtin_shufflevector(__s0_730, __s0_730, 3, 2, 1, 0); \
59123 int16x8_t __rev1_730; __rev1_730 = __builtin_shufflevector(__s1_730, __s1_730, 7, 6, 5, 4, 3, 2, 1, 0); \
59124 int16x8_t __rev2_730; __rev2_730 = __builtin_shufflevector(__s2_730, __s2_730, 7, 6, 5, 4, 3, 2, 1, 0); \
59125 __ret_730 = __noswap_vqdmlsl_s16(__rev0_730, __noswap_vget_high_s16(__rev1_730), __noswap_splat_laneq_s16(__rev2_730, __p3_730)); \
59126 __ret_730 = __builtin_shufflevector(__ret_730, __ret_730, 3, 2, 1, 0); \
59127 __ret_730; \
59128})
59102__ai uint16x4_t vsqadd_u16(uint16x4_t __p0, int16x4_t __p1) {
59103 uint16x4_t __ret;
59104 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
59105 int16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
59106 __ret = (uint16x4_t) __builtin_neon_vsqadd_v((int8x8_t)__rev0, (int8x8_t)__rev1, 17);
59107 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
59108 return __ret;
59109}
5912959110#endif
5913059111
5913159112#ifdef __LITTLE_ENDIAN__
59132__ai int64x2_t vqdmlsl_high_n_s32(int64x2_t __p0, int32x4_t __p1, int32_t __p2) {
59133 int64x2_t __ret;
59134 __ret = vqdmlsl_n_s32(__p0, vget_high_s32(__p1), __p2);
59113__ai float64x2_t vsqrtq_f64(float64x2_t __p0) {
59114 float64x2_t __ret;
59115 __ret = (float64x2_t) __builtin_neon_vsqrtq_v((int8x16_t)__p0, 42);
5913559116 return __ret;
5913659117}
5913759118#else
59138__ai int64x2_t vqdmlsl_high_n_s32(int64x2_t __p0, int32x4_t __p1, int32_t __p2) {
59139 int64x2_t __ret;
59140 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
59141 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
59142 __ret = __noswap_vqdmlsl_n_s32(__rev0, __noswap_vget_high_s32(__rev1), __p2);
59119__ai float64x2_t vsqrtq_f64(float64x2_t __p0) {
59120 float64x2_t __ret;
59121 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
59122 __ret = (float64x2_t) __builtin_neon_vsqrtq_v((int8x16_t)__rev0, 42);
5914359123 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
5914459124 return __ret;
5914559125}
5914659126#endif
5914759127
5914859128#ifdef __LITTLE_ENDIAN__
59149__ai int32x4_t vqdmlsl_high_n_s16(int32x4_t __p0, int16x8_t __p1, int16_t __p2) {
59150 int32x4_t __ret;
59151 __ret = vqdmlsl_n_s16(__p0, vget_high_s16(__p1), __p2);
59129__ai float32x4_t vsqrtq_f32(float32x4_t __p0) {
59130 float32x4_t __ret;
59131 __ret = (float32x4_t) __builtin_neon_vsqrtq_v((int8x16_t)__p0, 41);
5915259132 return __ret;
5915359133}
5915459134#else
59155__ai int32x4_t vqdmlsl_high_n_s16(int32x4_t __p0, int16x8_t __p1, int16_t __p2) {
59156 int32x4_t __ret;
59157 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
59158 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
59159 __ret = __noswap_vqdmlsl_n_s16(__rev0, __noswap_vget_high_s16(__rev1), __p2);
59135__ai float32x4_t vsqrtq_f32(float32x4_t __p0) {
59136 float32x4_t __ret;
59137 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
59138 __ret = (float32x4_t) __builtin_neon_vsqrtq_v((int8x16_t)__rev0, 41);
5916059139 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
5916159140 return __ret;
5916259141}
5916359142#endif
5916459143
59144__ai float64x1_t vsqrt_f64(float64x1_t __p0) {
59145 float64x1_t __ret;
59146 __ret = (float64x1_t) __builtin_neon_vsqrt_v((int8x8_t)__p0, 10);
59147 return __ret;
59148}
5916559149#ifdef __LITTLE_ENDIAN__
59166#define vqdmlsls_lane_s32(__p0, __p1, __p2, __p3) __extension__ ({ \
59167 int64_t __ret; \
59168 int64_t __s0 = __p0; \
59169 int32_t __s1 = __p1; \
59170 int32x2_t __s2 = __p2; \
59171 __ret = (int64_t) __builtin_neon_vqdmlsls_lane_s32(__s0, __s1, __s2, __p3); \
59150__ai float32x2_t vsqrt_f32(float32x2_t __p0) {
59151 float32x2_t __ret;
59152 __ret = (float32x2_t) __builtin_neon_vsqrt_v((int8x8_t)__p0, 9);
59153 return __ret;
59154}
59155#else
59156__ai float32x2_t vsqrt_f32(float32x2_t __p0) {
59157 float32x2_t __ret;
59158 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
59159 __ret = (float32x2_t) __builtin_neon_vsqrt_v((int8x8_t)__rev0, 9);
59160 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
59161 return __ret;
59162}
59163#endif
59164
59165#define vsrad_n_u64(__p0, __p1, __p2) __extension__ ({ \
59166 uint64_t __ret; \
59167 uint64_t __s0 = __p0; \
59168 uint64_t __s1 = __p1; \
59169 __ret = (uint64_t) __builtin_neon_vsrad_n_u64(__s0, __s1, __p2); \
5917259170 __ret; \
5917359171})
59174#else
59175#define vqdmlsls_lane_s32(__p0, __p1, __p2, __p3) __extension__ ({ \
59172#define vsrad_n_s64(__p0, __p1, __p2) __extension__ ({ \
5917659173 int64_t __ret; \
5917759174 int64_t __s0 = __p0; \
59178 int32_t __s1 = __p1; \
59179 int32x2_t __s2 = __p2; \
59180 int32x2_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 1, 0); \
59181 __ret = (int64_t) __builtin_neon_vqdmlsls_lane_s32(__s0, __s1, __rev2, __p3); \
59182 __ret; \
59183})
59184#endif
59185
59186#ifdef __LITTLE_ENDIAN__
59187#define vqdmlslh_lane_s16(__p0, __p1, __p2, __p3) __extension__ ({ \
59188 int32_t __ret; \
59189 int32_t __s0 = __p0; \
59190 int16_t __s1 = __p1; \
59191 int16x4_t __s2 = __p2; \
59192 __ret = (int32_t) __builtin_neon_vqdmlslh_lane_s16(__s0, __s1, __s2, __p3); \
59175 int64_t __s1 = __p1; \
59176 __ret = (int64_t) __builtin_neon_vsrad_n_s64(__s0, __s1, __p2); \
5919359177 __ret; \
5919459178})
59195#else
59196#define vqdmlslh_lane_s16(__p0, __p1, __p2, __p3) __extension__ ({ \
59197 int32_t __ret; \
59198 int32_t __s0 = __p0; \
59199 int16_t __s1 = __p1; \
59200 int16x4_t __s2 = __p2; \
59201 int16x4_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 3, 2, 1, 0); \
59202 __ret = (int32_t) __builtin_neon_vqdmlslh_lane_s16(__s0, __s1, __rev2, __p3); \
59179#define vsrid_n_u64(__p0, __p1, __p2) __extension__ ({ \
59180 uint64_t __ret; \
59181 uint64_t __s0 = __p0; \
59182 uint64_t __s1 = __p1; \
59183 __ret = (uint64_t) __builtin_neon_vsrid_n_u64(__s0, __s1, __p2); \
5920359184 __ret; \
5920459185})
59205#endif
59206
59207#ifdef __LITTLE_ENDIAN__
59208#define vqdmlsls_laneq_s32(__p0, __p1, __p2, __p3) __extension__ ({ \
59186#define vsrid_n_s64(__p0, __p1, __p2) __extension__ ({ \
5920959187 int64_t __ret; \
5921059188 int64_t __s0 = __p0; \
59211 int32_t __s1 = __p1; \
59212 int32x4_t __s2 = __p2; \
59213 __ret = (int64_t) __builtin_neon_vqdmlsls_laneq_s32(__s0, __s1, __s2, __p3); \
59189 int64_t __s1 = __p1; \
59190 __ret = (int64_t) __builtin_neon_vsrid_n_s64(__s0, __s1, __p2); \
5921459191 __ret; \
5921559192})
59216#else
59217#define vqdmlsls_laneq_s32(__p0, __p1, __p2, __p3) __extension__ ({ \
59218 int64_t __ret; \
59219 int64_t __s0 = __p0; \
59220 int32_t __s1 = __p1; \
59221 int32x4_t __s2 = __p2; \
59222 int32x4_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 3, 2, 1, 0); \
59223 __ret = (int64_t) __builtin_neon_vqdmlsls_laneq_s32(__s0, __s1, __rev2, __p3); \
59193#define vsri_n_p64(__p0, __p1, __p2) __extension__ ({ \
59194 poly64x1_t __ret; \
59195 poly64x1_t __s0 = __p0; \
59196 poly64x1_t __s1 = __p1; \
59197 __ret = (poly64x1_t) __builtin_neon_vsri_n_v((int8x8_t)__s0, (int8x8_t)__s1, __p2, 6); \
5922459198 __ret; \
5922559199})
59226#endif
59227
5922859200#ifdef __LITTLE_ENDIAN__
59229#define vqdmlslh_laneq_s16(__p0, __p1, __p2, __p3) __extension__ ({ \
59230 int32_t __ret; \
59231 int32_t __s0 = __p0; \
59232 int16_t __s1 = __p1; \
59233 int16x8_t __s2 = __p2; \
59234 __ret = (int32_t) __builtin_neon_vqdmlslh_laneq_s16(__s0, __s1, __s2, __p3); \
59201#define vsriq_n_p64(__p0, __p1, __p2) __extension__ ({ \
59202 poly64x2_t __ret; \
59203 poly64x2_t __s0 = __p0; \
59204 poly64x2_t __s1 = __p1; \
59205 __ret = (poly64x2_t) __builtin_neon_vsriq_n_v((int8x16_t)__s0, (int8x16_t)__s1, __p2, 38); \
5923559206 __ret; \
5923659207})
5923759208#else
59238#define vqdmlslh_laneq_s16(__p0, __p1, __p2, __p3) __extension__ ({ \
59239 int32_t __ret; \
59240 int32_t __s0 = __p0; \
59241 int16_t __s1 = __p1; \
59242 int16x8_t __s2 = __p2; \
59243 int16x8_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 7, 6, 5, 4, 3, 2, 1, 0); \
59244 __ret = (int32_t) __builtin_neon_vqdmlslh_laneq_s16(__s0, __s1, __rev2, __p3); \
59209#define vsriq_n_p64(__p0, __p1, __p2) __extension__ ({ \
59210 poly64x2_t __ret; \
59211 poly64x2_t __s0 = __p0; \
59212 poly64x2_t __s1 = __p1; \
59213 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
59214 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
59215 __ret = (poly64x2_t) __builtin_neon_vsriq_n_v((int8x16_t)__rev0, (int8x16_t)__rev1, __p2, 38); \
59216 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
5924559217 __ret; \
5924659218})
5924759219#endif
5924859220
59249#ifdef __LITTLE_ENDIAN__
59250#define vqdmlsl_laneq_s32(__p0_731, __p1_731, __p2_731, __p3_731) __extension__ ({ \
59251 int64x2_t __ret_731; \
59252 int64x2_t __s0_731 = __p0_731; \
59253 int32x2_t __s1_731 = __p1_731; \
59254 int32x4_t __s2_731 = __p2_731; \
59255 __ret_731 = vqdmlsl_s32(__s0_731, __s1_731, splat_laneq_s32(__s2_731, __p3_731)); \
59256 __ret_731; \
59257})
59258#else
59259#define vqdmlsl_laneq_s32(__p0_732, __p1_732, __p2_732, __p3_732) __extension__ ({ \
59260 int64x2_t __ret_732; \
59261 int64x2_t __s0_732 = __p0_732; \
59262 int32x2_t __s1_732 = __p1_732; \
59263 int32x4_t __s2_732 = __p2_732; \
59264 int64x2_t __rev0_732; __rev0_732 = __builtin_shufflevector(__s0_732, __s0_732, 1, 0); \
59265 int32x2_t __rev1_732; __rev1_732 = __builtin_shufflevector(__s1_732, __s1_732, 1, 0); \
59266 int32x4_t __rev2_732; __rev2_732 = __builtin_shufflevector(__s2_732, __s2_732, 3, 2, 1, 0); \
59267 __ret_732 = __noswap_vqdmlsl_s32(__rev0_732, __rev1_732, __noswap_splat_laneq_s32(__rev2_732, __p3_732)); \
59268 __ret_732 = __builtin_shufflevector(__ret_732, __ret_732, 1, 0); \
59269 __ret_732; \
59221#define vst1_p64(__p0, __p1) __extension__ ({ \
59222 poly64x1_t __s1 = __p1; \
59223 __builtin_neon_vst1_v(__p0, (int8x8_t)__s1, 6); \
5927059224})
59271#endif
59272
5927359225#ifdef __LITTLE_ENDIAN__
59274#define vqdmlsl_laneq_s16(__p0_733, __p1_733, __p2_733, __p3_733) __extension__ ({ \
59275 int32x4_t __ret_733; \
59276 int32x4_t __s0_733 = __p0_733; \
59277 int16x4_t __s1_733 = __p1_733; \
59278 int16x8_t __s2_733 = __p2_733; \
59279 __ret_733 = vqdmlsl_s16(__s0_733, __s1_733, splat_laneq_s16(__s2_733, __p3_733)); \
59280 __ret_733; \
59226#define vst1q_p64(__p0, __p1) __extension__ ({ \
59227 poly64x2_t __s1 = __p1; \
59228 __builtin_neon_vst1q_v(__p0, (int8x16_t)__s1, 38); \
5928159229})
5928259230#else
59283#define vqdmlsl_laneq_s16(__p0_734, __p1_734, __p2_734, __p3_734) __extension__ ({ \
59284 int32x4_t __ret_734; \
59285 int32x4_t __s0_734 = __p0_734; \
59286 int16x4_t __s1_734 = __p1_734; \
59287 int16x8_t __s2_734 = __p2_734; \
59288 int32x4_t __rev0_734; __rev0_734 = __builtin_shufflevector(__s0_734, __s0_734, 3, 2, 1, 0); \
59289 int16x4_t __rev1_734; __rev1_734 = __builtin_shufflevector(__s1_734, __s1_734, 3, 2, 1, 0); \
59290 int16x8_t __rev2_734; __rev2_734 = __builtin_shufflevector(__s2_734, __s2_734, 7, 6, 5, 4, 3, 2, 1, 0); \
59291 __ret_734 = __noswap_vqdmlsl_s16(__rev0_734, __rev1_734, __noswap_splat_laneq_s16(__rev2_734, __p3_734)); \
59292 __ret_734 = __builtin_shufflevector(__ret_734, __ret_734, 3, 2, 1, 0); \
59293 __ret_734; \
59231#define vst1q_p64(__p0, __p1) __extension__ ({ \
59232 poly64x2_t __s1 = __p1; \
59233 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
59234 __builtin_neon_vst1q_v(__p0, (int8x16_t)__rev1, 38); \
5929459235})
5929559236#endif
5929659237
59297__ai int32_t vqdmulhs_s32(int32_t __p0, int32_t __p1) {
59298 int32_t __ret;
59299 __ret = (int32_t) __builtin_neon_vqdmulhs_s32(__p0, __p1);
59300 return __ret;
59301}
59302__ai int16_t vqdmulhh_s16(int16_t __p0, int16_t __p1) {
59303 int16_t __ret;
59304 __ret = (int16_t) __builtin_neon_vqdmulhh_s16(__p0, __p1);
59305 return __ret;
59306}
5930759238#ifdef __LITTLE_ENDIAN__
59308#define vqdmulhq_lane_s32(__p0, __p1, __p2) __extension__ ({ \
59309 int32x4_t __ret; \
59310 int32x4_t __s0 = __p0; \
59311 int32x2_t __s1 = __p1; \
59312 __ret = (int32x4_t) __builtin_neon_vqdmulhq_lane_v((int8x16_t)__s0, (int8x8_t)__s1, __p2, 2); \
59313 __ret; \
59239#define vst1q_f64(__p0, __p1) __extension__ ({ \
59240 float64x2_t __s1 = __p1; \
59241 __builtin_neon_vst1q_v(__p0, (int8x16_t)__s1, 42); \
5931459242})
5931559243#else
59316#define vqdmulhq_lane_s32(__p0, __p1, __p2) __extension__ ({ \
59317 int32x4_t __ret; \
59318 int32x4_t __s0 = __p0; \
59319 int32x2_t __s1 = __p1; \
59320 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
59321 int32x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
59322 __ret = (int32x4_t) __builtin_neon_vqdmulhq_lane_v((int8x16_t)__rev0, (int8x8_t)__rev1, __p2, 2); \
59323 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
59324 __ret; \
59244#define vst1q_f64(__p0, __p1) __extension__ ({ \
59245 float64x2_t __s1 = __p1; \
59246 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
59247 __builtin_neon_vst1q_v(__p0, (int8x16_t)__rev1, 42); \
5932559248})
5932659249#endif
5932759250
59328#ifdef __LITTLE_ENDIAN__
59329#define vqdmulhq_lane_s16(__p0, __p1, __p2) __extension__ ({ \
59330 int16x8_t __ret; \
59331 int16x8_t __s0 = __p0; \
59332 int16x4_t __s1 = __p1; \
59333 __ret = (int16x8_t) __builtin_neon_vqdmulhq_lane_v((int8x16_t)__s0, (int8x8_t)__s1, __p2, 1); \
59334 __ret; \
59251#define vst1_f64(__p0, __p1) __extension__ ({ \
59252 float64x1_t __s1 = __p1; \
59253 __builtin_neon_vst1_v(__p0, (int8x8_t)__s1, 10); \
5933559254})
59336#else
59337#define vqdmulhq_lane_s16(__p0, __p1, __p2) __extension__ ({ \
59338 int16x8_t __ret; \
59339 int16x8_t __s0 = __p0; \
59340 int16x4_t __s1 = __p1; \
59341 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
59342 int16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
59343 __ret = (int16x8_t) __builtin_neon_vqdmulhq_lane_v((int8x16_t)__rev0, (int8x8_t)__rev1, __p2, 1); \
59344 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
59345 __ret; \
59255#define vst1_lane_p64(__p0, __p1, __p2) __extension__ ({ \
59256 poly64x1_t __s1 = __p1; \
59257 __builtin_neon_vst1_lane_v(__p0, (int8x8_t)__s1, __p2, 6); \
5934659258})
59347#endif
59348
5934959259#ifdef __LITTLE_ENDIAN__
59350#define vqdmulh_lane_s32(__p0, __p1, __p2) __extension__ ({ \
59351 int32x2_t __ret; \
59352 int32x2_t __s0 = __p0; \
59353 int32x2_t __s1 = __p1; \
59354 __ret = (int32x2_t) __builtin_neon_vqdmulh_lane_v((int8x8_t)__s0, (int8x8_t)__s1, __p2, 2); \
59355 __ret; \
59260#define vst1q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
59261 poly64x2_t __s1 = __p1; \
59262 __builtin_neon_vst1q_lane_v(__p0, (int8x16_t)__s1, __p2, 38); \
5935659263})
5935759264#else
59358#define vqdmulh_lane_s32(__p0, __p1, __p2) __extension__ ({ \
59359 int32x2_t __ret; \
59360 int32x2_t __s0 = __p0; \
59361 int32x2_t __s1 = __p1; \
59362 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
59363 int32x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
59364 __ret = (int32x2_t) __builtin_neon_vqdmulh_lane_v((int8x8_t)__rev0, (int8x8_t)__rev1, __p2, 2); \
59365 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
59366 __ret; \
59265#define vst1q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
59266 poly64x2_t __s1 = __p1; \
59267 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
59268 __builtin_neon_vst1q_lane_v(__p0, (int8x16_t)__rev1, __p2, 38); \
5936759269})
5936859270#endif
5936959271
5937059272#ifdef __LITTLE_ENDIAN__
59371#define vqdmulh_lane_s16(__p0, __p1, __p2) __extension__ ({ \
59372 int16x4_t __ret; \
59373 int16x4_t __s0 = __p0; \
59374 int16x4_t __s1 = __p1; \
59375 __ret = (int16x4_t) __builtin_neon_vqdmulh_lane_v((int8x8_t)__s0, (int8x8_t)__s1, __p2, 1); \
59376 __ret; \
59273#define vst1q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
59274 float64x2_t __s1 = __p1; \
59275 __builtin_neon_vst1q_lane_v(__p0, (int8x16_t)__s1, __p2, 42); \
5937759276})
5937859277#else
59379#define vqdmulh_lane_s16(__p0, __p1, __p2) __extension__ ({ \
59380 int16x4_t __ret; \
59381 int16x4_t __s0 = __p0; \
59382 int16x4_t __s1 = __p1; \
59383 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
59384 int16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
59385 __ret = (int16x4_t) __builtin_neon_vqdmulh_lane_v((int8x8_t)__rev0, (int8x8_t)__rev1, __p2, 1); \
59386 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
59387 __ret; \
59278#define vst1q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
59279 float64x2_t __s1 = __p1; \
59280 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
59281 __builtin_neon_vst1q_lane_v(__p0, (int8x16_t)__rev1, __p2, 42); \
5938859282})
5938959283#endif
5939059284
59391#ifdef __LITTLE_ENDIAN__
59392#define vqdmulhs_lane_s32(__p0_735, __p1_735, __p2_735) __extension__ ({ \
59393 int32_t __ret_735; \
59394 int32_t __s0_735 = __p0_735; \
59395 int32x2_t __s1_735 = __p1_735; \
59396 __ret_735 = vqdmulhs_s32(__s0_735, vget_lane_s32(__s1_735, __p2_735)); \
59397 __ret_735; \
59285#define vst1_lane_f64(__p0, __p1, __p2) __extension__ ({ \
59286 float64x1_t __s1 = __p1; \
59287 __builtin_neon_vst1_lane_v(__p0, (int8x8_t)__s1, __p2, 10); \
5939859288})
59399#else
59400#define vqdmulhs_lane_s32(__p0_736, __p1_736, __p2_736) __extension__ ({ \
59401 int32_t __ret_736; \
59402 int32_t __s0_736 = __p0_736; \
59403 int32x2_t __s1_736 = __p1_736; \
59404 int32x2_t __rev1_736; __rev1_736 = __builtin_shufflevector(__s1_736, __s1_736, 1, 0); \
59405 __ret_736 = vqdmulhs_s32(__s0_736, __noswap_vget_lane_s32(__rev1_736, __p2_736)); \
59406 __ret_736; \
59289#define vst1_p64_x2(__p0, __p1) __extension__ ({ \
59290 poly64x1x2_t __s1 = __p1; \
59291 __builtin_neon_vst1_x2_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], 6); \
5940759292})
59408#endif
59409
5941059293#ifdef __LITTLE_ENDIAN__
59411#define vqdmulhh_lane_s16(__p0_737, __p1_737, __p2_737) __extension__ ({ \
59412 int16_t __ret_737; \
59413 int16_t __s0_737 = __p0_737; \
59414 int16x4_t __s1_737 = __p1_737; \
59415 __ret_737 = vqdmulhh_s16(__s0_737, vget_lane_s16(__s1_737, __p2_737)); \
59416 __ret_737; \
59294#define vst1q_p64_x2(__p0, __p1) __extension__ ({ \
59295 poly64x2x2_t __s1 = __p1; \
59296 __builtin_neon_vst1q_x2_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], 38); \
5941759297})
5941859298#else
59419#define vqdmulhh_lane_s16(__p0_738, __p1_738, __p2_738) __extension__ ({ \
59420 int16_t __ret_738; \
59421 int16_t __s0_738 = __p0_738; \
59422 int16x4_t __s1_738 = __p1_738; \
59423 int16x4_t __rev1_738; __rev1_738 = __builtin_shufflevector(__s1_738, __s1_738, 3, 2, 1, 0); \
59424 __ret_738 = vqdmulhh_s16(__s0_738, __noswap_vget_lane_s16(__rev1_738, __p2_738)); \
59425 __ret_738; \
59299#define vst1q_p64_x2(__p0, __p1) __extension__ ({ \
59300 poly64x2x2_t __s1 = __p1; \
59301 poly64x2x2_t __rev1; \
59302 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59303 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59304 __builtin_neon_vst1q_x2_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], 38); \
5942659305})
5942759306#endif
5942859307
5942959308#ifdef __LITTLE_ENDIAN__
59430#define vqdmulhs_laneq_s32(__p0_739, __p1_739, __p2_739) __extension__ ({ \
59431 int32_t __ret_739; \
59432 int32_t __s0_739 = __p0_739; \
59433 int32x4_t __s1_739 = __p1_739; \
59434 __ret_739 = vqdmulhs_s32(__s0_739, vgetq_lane_s32(__s1_739, __p2_739)); \
59435 __ret_739; \
59309#define vst1q_f64_x2(__p0, __p1) __extension__ ({ \
59310 float64x2x2_t __s1 = __p1; \
59311 __builtin_neon_vst1q_x2_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], 42); \
5943659312})
5943759313#else
59438#define vqdmulhs_laneq_s32(__p0_740, __p1_740, __p2_740) __extension__ ({ \
59439 int32_t __ret_740; \
59440 int32_t __s0_740 = __p0_740; \
59441 int32x4_t __s1_740 = __p1_740; \
59442 int32x4_t __rev1_740; __rev1_740 = __builtin_shufflevector(__s1_740, __s1_740, 3, 2, 1, 0); \
59443 __ret_740 = vqdmulhs_s32(__s0_740, __noswap_vgetq_lane_s32(__rev1_740, __p2_740)); \
59444 __ret_740; \
59314#define vst1q_f64_x2(__p0, __p1) __extension__ ({ \
59315 float64x2x2_t __s1 = __p1; \
59316 float64x2x2_t __rev1; \
59317 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59318 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59319 __builtin_neon_vst1q_x2_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], 42); \
5944559320})
5944659321#endif
5944759322
59448#ifdef __LITTLE_ENDIAN__
59449#define vqdmulhh_laneq_s16(__p0_741, __p1_741, __p2_741) __extension__ ({ \
59450 int16_t __ret_741; \
59451 int16_t __s0_741 = __p0_741; \
59452 int16x8_t __s1_741 = __p1_741; \
59453 __ret_741 = vqdmulhh_s16(__s0_741, vgetq_lane_s16(__s1_741, __p2_741)); \
59454 __ret_741; \
59323#define vst1_f64_x2(__p0, __p1) __extension__ ({ \
59324 float64x1x2_t __s1 = __p1; \
59325 __builtin_neon_vst1_x2_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], 10); \
5945559326})
59456#else
59457#define vqdmulhh_laneq_s16(__p0_742, __p1_742, __p2_742) __extension__ ({ \
59458 int16_t __ret_742; \
59459 int16_t __s0_742 = __p0_742; \
59460 int16x8_t __s1_742 = __p1_742; \
59461 int16x8_t __rev1_742; __rev1_742 = __builtin_shufflevector(__s1_742, __s1_742, 7, 6, 5, 4, 3, 2, 1, 0); \
59462 __ret_742 = vqdmulhh_s16(__s0_742, __noswap_vgetq_lane_s16(__rev1_742, __p2_742)); \
59463 __ret_742; \
59327#define vst1_p64_x3(__p0, __p1) __extension__ ({ \
59328 poly64x1x3_t __s1 = __p1; \
59329 __builtin_neon_vst1_x3_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], 6); \
5946459330})
59465#endif
59466
5946759331#ifdef __LITTLE_ENDIAN__
59468#define vqdmulhq_laneq_s32(__p0, __p1, __p2) __extension__ ({ \
59469 int32x4_t __ret; \
59470 int32x4_t __s0 = __p0; \
59471 int32x4_t __s1 = __p1; \
59472 __ret = (int32x4_t) __builtin_neon_vqdmulhq_laneq_v((int8x16_t)__s0, (int8x16_t)__s1, __p2, 34); \
59473 __ret; \
59332#define vst1q_p64_x3(__p0, __p1) __extension__ ({ \
59333 poly64x2x3_t __s1 = __p1; \
59334 __builtin_neon_vst1q_x3_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], 38); \
5947459335})
5947559336#else
59476#define vqdmulhq_laneq_s32(__p0, __p1, __p2) __extension__ ({ \
59477 int32x4_t __ret; \
59478 int32x4_t __s0 = __p0; \
59479 int32x4_t __s1 = __p1; \
59480 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
59481 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
59482 __ret = (int32x4_t) __builtin_neon_vqdmulhq_laneq_v((int8x16_t)__rev0, (int8x16_t)__rev1, __p2, 34); \
59483 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
59484 __ret; \
59337#define vst1q_p64_x3(__p0, __p1) __extension__ ({ \
59338 poly64x2x3_t __s1 = __p1; \
59339 poly64x2x3_t __rev1; \
59340 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59341 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59342 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
59343 __builtin_neon_vst1q_x3_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], 38); \
5948559344})
5948659345#endif
5948759346
5948859347#ifdef __LITTLE_ENDIAN__
59489#define vqdmulhq_laneq_s16(__p0, __p1, __p2) __extension__ ({ \
59490 int16x8_t __ret; \
59491 int16x8_t __s0 = __p0; \
59492 int16x8_t __s1 = __p1; \
59493 __ret = (int16x8_t) __builtin_neon_vqdmulhq_laneq_v((int8x16_t)__s0, (int8x16_t)__s1, __p2, 33); \
59494 __ret; \
59348#define vst1q_f64_x3(__p0, __p1) __extension__ ({ \
59349 float64x2x3_t __s1 = __p1; \
59350 __builtin_neon_vst1q_x3_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], 42); \
5949559351})
5949659352#else
59497#define vqdmulhq_laneq_s16(__p0, __p1, __p2) __extension__ ({ \
59498 int16x8_t __ret; \
59499 int16x8_t __s0 = __p0; \
59500 int16x8_t __s1 = __p1; \
59501 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
59502 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
59503 __ret = (int16x8_t) __builtin_neon_vqdmulhq_laneq_v((int8x16_t)__rev0, (int8x16_t)__rev1, __p2, 33); \
59504 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
59505 __ret; \
59353#define vst1q_f64_x3(__p0, __p1) __extension__ ({ \
59354 float64x2x3_t __s1 = __p1; \
59355 float64x2x3_t __rev1; \
59356 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59357 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59358 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
59359 __builtin_neon_vst1q_x3_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], 42); \
5950659360})
5950759361#endif
5950859362
59509#ifdef __LITTLE_ENDIAN__
59510#define vqdmulh_laneq_s32(__p0, __p1, __p2) __extension__ ({ \
59511 int32x2_t __ret; \
59512 int32x2_t __s0 = __p0; \
59513 int32x4_t __s1 = __p1; \
59514 __ret = (int32x2_t) __builtin_neon_vqdmulh_laneq_v((int8x8_t)__s0, (int8x16_t)__s1, __p2, 2); \
59515 __ret; \
59363#define vst1_f64_x3(__p0, __p1) __extension__ ({ \
59364 float64x1x3_t __s1 = __p1; \
59365 __builtin_neon_vst1_x3_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], 10); \
5951659366})
59517#else
59518#define vqdmulh_laneq_s32(__p0, __p1, __p2) __extension__ ({ \
59519 int32x2_t __ret; \
59520 int32x2_t __s0 = __p0; \
59521 int32x4_t __s1 = __p1; \
59522 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
59523 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
59524 __ret = (int32x2_t) __builtin_neon_vqdmulh_laneq_v((int8x8_t)__rev0, (int8x16_t)__rev1, __p2, 2); \
59525 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
59526 __ret; \
59367#define vst1_p64_x4(__p0, __p1) __extension__ ({ \
59368 poly64x1x4_t __s1 = __p1; \
59369 __builtin_neon_vst1_x4_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], 6); \
5952759370})
59528#endif
59529
5953059371#ifdef __LITTLE_ENDIAN__
59531#define vqdmulh_laneq_s16(__p0, __p1, __p2) __extension__ ({ \
59532 int16x4_t __ret; \
59533 int16x4_t __s0 = __p0; \
59534 int16x8_t __s1 = __p1; \
59535 __ret = (int16x4_t) __builtin_neon_vqdmulh_laneq_v((int8x8_t)__s0, (int8x16_t)__s1, __p2, 1); \
59536 __ret; \
59372#define vst1q_p64_x4(__p0, __p1) __extension__ ({ \
59373 poly64x2x4_t __s1 = __p1; \
59374 __builtin_neon_vst1q_x4_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], 38); \
5953759375})
5953859376#else
59539#define vqdmulh_laneq_s16(__p0, __p1, __p2) __extension__ ({ \
59540 int16x4_t __ret; \
59541 int16x4_t __s0 = __p0; \
59542 int16x8_t __s1 = __p1; \
59543 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
59544 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
59545 __ret = (int16x4_t) __builtin_neon_vqdmulh_laneq_v((int8x8_t)__rev0, (int8x16_t)__rev1, __p2, 1); \
59546 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
59547 __ret; \
59377#define vst1q_p64_x4(__p0, __p1) __extension__ ({ \
59378 poly64x2x4_t __s1 = __p1; \
59379 poly64x2x4_t __rev1; \
59380 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59381 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59382 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
59383 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 1, 0); \
59384 __builtin_neon_vst1q_x4_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], 38); \
5954859385})
5954959386#endif
5955059387
59551__ai int64_t vqdmulls_s32(int32_t __p0, int32_t __p1) {
59552 int64_t __ret;
59553 __ret = (int64_t) __builtin_neon_vqdmulls_s32(__p0, __p1);
59554 return __ret;
59555}
59556__ai int32_t vqdmullh_s16(int16_t __p0, int16_t __p1) {
59557 int32_t __ret;
59558 __ret = (int32_t) __builtin_neon_vqdmullh_s16(__p0, __p1);
59559 return __ret;
59560}
59561#ifdef __LITTLE_ENDIAN__
59562__ai int64x2_t vqdmull_high_s32(int32x4_t __p0, int32x4_t __p1) {
59563 int64x2_t __ret;
59564 __ret = vqdmull_s32(vget_high_s32(__p0), vget_high_s32(__p1));
59565 return __ret;
59566}
59567#else
59568__ai int64x2_t vqdmull_high_s32(int32x4_t __p0, int32x4_t __p1) {
59569 int64x2_t __ret;
59570 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
59571 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
59572 __ret = __noswap_vqdmull_s32(__noswap_vget_high_s32(__rev0), __noswap_vget_high_s32(__rev1));
59573 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
59574 return __ret;
59575}
59576#endif
59577
59578#ifdef __LITTLE_ENDIAN__
59579__ai int32x4_t vqdmull_high_s16(int16x8_t __p0, int16x8_t __p1) {
59580 int32x4_t __ret;
59581 __ret = vqdmull_s16(vget_high_s16(__p0), vget_high_s16(__p1));
59582 return __ret;
59583}
59584#else
59585__ai int32x4_t vqdmull_high_s16(int16x8_t __p0, int16x8_t __p1) {
59586 int32x4_t __ret;
59587 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
59588 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
59589 __ret = __noswap_vqdmull_s16(__noswap_vget_high_s16(__rev0), __noswap_vget_high_s16(__rev1));
59590 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
59591 return __ret;
59592}
59593#endif
59594
5959559388#ifdef __LITTLE_ENDIAN__
59596#define vqdmull_high_lane_s32(__p0_743, __p1_743, __p2_743) __extension__ ({ \
59597 int64x2_t __ret_743; \
59598 int32x4_t __s0_743 = __p0_743; \
59599 int32x2_t __s1_743 = __p1_743; \
59600 __ret_743 = vqdmull_s32(vget_high_s32(__s0_743), splat_lane_s32(__s1_743, __p2_743)); \
59601 __ret_743; \
59389#define vst1q_f64_x4(__p0, __p1) __extension__ ({ \
59390 float64x2x4_t __s1 = __p1; \
59391 __builtin_neon_vst1q_x4_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], 42); \
5960259392})
5960359393#else
59604#define vqdmull_high_lane_s32(__p0_744, __p1_744, __p2_744) __extension__ ({ \
59605 int64x2_t __ret_744; \
59606 int32x4_t __s0_744 = __p0_744; \
59607 int32x2_t __s1_744 = __p1_744; \
59608 int32x4_t __rev0_744; __rev0_744 = __builtin_shufflevector(__s0_744, __s0_744, 3, 2, 1, 0); \
59609 int32x2_t __rev1_744; __rev1_744 = __builtin_shufflevector(__s1_744, __s1_744, 1, 0); \
59610 __ret_744 = __noswap_vqdmull_s32(__noswap_vget_high_s32(__rev0_744), __noswap_splat_lane_s32(__rev1_744, __p2_744)); \
59611 __ret_744 = __builtin_shufflevector(__ret_744, __ret_744, 1, 0); \
59612 __ret_744; \
59394#define vst1q_f64_x4(__p0, __p1) __extension__ ({ \
59395 float64x2x4_t __s1 = __p1; \
59396 float64x2x4_t __rev1; \
59397 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59398 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59399 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
59400 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 1, 0); \
59401 __builtin_neon_vst1q_x4_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], 42); \
5961359402})
5961459403#endif
5961559404
59405#define vst1_f64_x4(__p0, __p1) __extension__ ({ \
59406 float64x1x4_t __s1 = __p1; \
59407 __builtin_neon_vst1_x4_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], 10); \
59408})
59409#define vst2_p64(__p0, __p1) __extension__ ({ \
59410 poly64x1x2_t __s1 = __p1; \
59411 __builtin_neon_vst2_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], 6); \
59412})
5961659413#ifdef __LITTLE_ENDIAN__
59617#define vqdmull_high_lane_s16(__p0_745, __p1_745, __p2_745) __extension__ ({ \
59618 int32x4_t __ret_745; \
59619 int16x8_t __s0_745 = __p0_745; \
59620 int16x4_t __s1_745 = __p1_745; \
59621 __ret_745 = vqdmull_s16(vget_high_s16(__s0_745), splat_lane_s16(__s1_745, __p2_745)); \
59622 __ret_745; \
59414#define vst2q_p64(__p0, __p1) __extension__ ({ \
59415 poly64x2x2_t __s1 = __p1; \
59416 __builtin_neon_vst2q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], 38); \
5962359417})
5962459418#else
59625#define vqdmull_high_lane_s16(__p0_746, __p1_746, __p2_746) __extension__ ({ \
59626 int32x4_t __ret_746; \
59627 int16x8_t __s0_746 = __p0_746; \
59628 int16x4_t __s1_746 = __p1_746; \
59629 int16x8_t __rev0_746; __rev0_746 = __builtin_shufflevector(__s0_746, __s0_746, 7, 6, 5, 4, 3, 2, 1, 0); \
59630 int16x4_t __rev1_746; __rev1_746 = __builtin_shufflevector(__s1_746, __s1_746, 3, 2, 1, 0); \
59631 __ret_746 = __noswap_vqdmull_s16(__noswap_vget_high_s16(__rev0_746), __noswap_splat_lane_s16(__rev1_746, __p2_746)); \
59632 __ret_746 = __builtin_shufflevector(__ret_746, __ret_746, 3, 2, 1, 0); \
59633 __ret_746; \
59419#define vst2q_p64(__p0, __p1) __extension__ ({ \
59420 poly64x2x2_t __s1 = __p1; \
59421 poly64x2x2_t __rev1; \
59422 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59423 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59424 __builtin_neon_vst2q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], 38); \
5963459425})
5963559426#endif
5963659427
5963759428#ifdef __LITTLE_ENDIAN__
59638#define vqdmull_high_laneq_s32(__p0_747, __p1_747, __p2_747) __extension__ ({ \
59639 int64x2_t __ret_747; \
59640 int32x4_t __s0_747 = __p0_747; \
59641 int32x4_t __s1_747 = __p1_747; \
59642 __ret_747 = vqdmull_s32(vget_high_s32(__s0_747), splat_laneq_s32(__s1_747, __p2_747)); \
59643 __ret_747; \
59429#define vst2q_u64(__p0, __p1) __extension__ ({ \
59430 uint64x2x2_t __s1 = __p1; \
59431 __builtin_neon_vst2q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], 51); \
5964459432})
5964559433#else
59646#define vqdmull_high_laneq_s32(__p0_748, __p1_748, __p2_748) __extension__ ({ \
59647 int64x2_t __ret_748; \
59648 int32x4_t __s0_748 = __p0_748; \
59649 int32x4_t __s1_748 = __p1_748; \
59650 int32x4_t __rev0_748; __rev0_748 = __builtin_shufflevector(__s0_748, __s0_748, 3, 2, 1, 0); \
59651 int32x4_t __rev1_748; __rev1_748 = __builtin_shufflevector(__s1_748, __s1_748, 3, 2, 1, 0); \
59652 __ret_748 = __noswap_vqdmull_s32(__noswap_vget_high_s32(__rev0_748), __noswap_splat_laneq_s32(__rev1_748, __p2_748)); \
59653 __ret_748 = __builtin_shufflevector(__ret_748, __ret_748, 1, 0); \
59654 __ret_748; \
59434#define vst2q_u64(__p0, __p1) __extension__ ({ \
59435 uint64x2x2_t __s1 = __p1; \
59436 uint64x2x2_t __rev1; \
59437 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59438 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59439 __builtin_neon_vst2q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], 51); \
5965559440})
5965659441#endif
5965759442
5965859443#ifdef __LITTLE_ENDIAN__
59659#define vqdmull_high_laneq_s16(__p0_749, __p1_749, __p2_749) __extension__ ({ \
59660 int32x4_t __ret_749; \
59661 int16x8_t __s0_749 = __p0_749; \
59662 int16x8_t __s1_749 = __p1_749; \
59663 __ret_749 = vqdmull_s16(vget_high_s16(__s0_749), splat_laneq_s16(__s1_749, __p2_749)); \
59664 __ret_749; \
59444#define vst2q_f64(__p0, __p1) __extension__ ({ \
59445 float64x2x2_t __s1 = __p1; \
59446 __builtin_neon_vst2q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], 42); \
5966559447})
5966659448#else
59667#define vqdmull_high_laneq_s16(__p0_750, __p1_750, __p2_750) __extension__ ({ \
59668 int32x4_t __ret_750; \
59669 int16x8_t __s0_750 = __p0_750; \
59670 int16x8_t __s1_750 = __p1_750; \
59671 int16x8_t __rev0_750; __rev0_750 = __builtin_shufflevector(__s0_750, __s0_750, 7, 6, 5, 4, 3, 2, 1, 0); \
59672 int16x8_t __rev1_750; __rev1_750 = __builtin_shufflevector(__s1_750, __s1_750, 7, 6, 5, 4, 3, 2, 1, 0); \
59673 __ret_750 = __noswap_vqdmull_s16(__noswap_vget_high_s16(__rev0_750), __noswap_splat_laneq_s16(__rev1_750, __p2_750)); \
59674 __ret_750 = __builtin_shufflevector(__ret_750, __ret_750, 3, 2, 1, 0); \
59675 __ret_750; \
59449#define vst2q_f64(__p0, __p1) __extension__ ({ \
59450 float64x2x2_t __s1 = __p1; \
59451 float64x2x2_t __rev1; \
59452 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59453 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59454 __builtin_neon_vst2q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], 42); \
5967659455})
5967759456#endif
5967859457
5967959458#ifdef __LITTLE_ENDIAN__
59680__ai int64x2_t vqdmull_high_n_s32(int32x4_t __p0, int32_t __p1) {
59681 int64x2_t __ret;
59682 __ret = vqdmull_n_s32(vget_high_s32(__p0), __p1);
59683 return __ret;
59684}
59459#define vst2q_s64(__p0, __p1) __extension__ ({ \
59460 int64x2x2_t __s1 = __p1; \
59461 __builtin_neon_vst2q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], 35); \
59462})
5968559463#else
59686__ai int64x2_t vqdmull_high_n_s32(int32x4_t __p0, int32_t __p1) {
59687 int64x2_t __ret;
59688 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
59689 __ret = __noswap_vqdmull_n_s32(__noswap_vget_high_s32(__rev0), __p1);
59690 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
59691 return __ret;
59692}
59464#define vst2q_s64(__p0, __p1) __extension__ ({ \
59465 int64x2x2_t __s1 = __p1; \
59466 int64x2x2_t __rev1; \
59467 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59468 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59469 __builtin_neon_vst2q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], 35); \
59470})
5969359471#endif
5969459472
59473#define vst2_f64(__p0, __p1) __extension__ ({ \
59474 float64x1x2_t __s1 = __p1; \
59475 __builtin_neon_vst2_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], 10); \
59476})
59477#define vst2_lane_p64(__p0, __p1, __p2) __extension__ ({ \
59478 poly64x1x2_t __s1 = __p1; \
59479 __builtin_neon_vst2_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], __p2, 6); \
59480})
5969559481#ifdef __LITTLE_ENDIAN__
59696__ai int32x4_t vqdmull_high_n_s16(int16x8_t __p0, int16_t __p1) {
59697 int32x4_t __ret;
59698 __ret = vqdmull_n_s16(vget_high_s16(__p0), __p1);
59699 return __ret;
59700}
59482#define vst2q_lane_p8(__p0, __p1, __p2) __extension__ ({ \
59483 poly8x16x2_t __s1 = __p1; \
59484 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 36); \
59485})
5970159486#else
59702__ai int32x4_t vqdmull_high_n_s16(int16x8_t __p0, int16_t __p1) {
59703 int32x4_t __ret;
59704 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
59705 __ret = __noswap_vqdmull_n_s16(__noswap_vget_high_s16(__rev0), __p1);
59706 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
59707 return __ret;
59708}
59487#define vst2q_lane_p8(__p0, __p1, __p2) __extension__ ({ \
59488 poly8x16x2_t __s1 = __p1; \
59489 poly8x16x2_t __rev1; \
59490 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
59491 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
59492 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 36); \
59493})
5970959494#endif
5971059495
5971159496#ifdef __LITTLE_ENDIAN__
59712#define vqdmulls_lane_s32(__p0_751, __p1_751, __p2_751) __extension__ ({ \
59713 int64_t __ret_751; \
59714 int32_t __s0_751 = __p0_751; \
59715 int32x2_t __s1_751 = __p1_751; \
59716 __ret_751 = vqdmulls_s32(__s0_751, vget_lane_s32(__s1_751, __p2_751)); \
59717 __ret_751; \
59497#define vst2q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
59498 poly64x2x2_t __s1 = __p1; \
59499 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 38); \
5971859500})
5971959501#else
59720#define vqdmulls_lane_s32(__p0_752, __p1_752, __p2_752) __extension__ ({ \
59721 int64_t __ret_752; \
59722 int32_t __s0_752 = __p0_752; \
59723 int32x2_t __s1_752 = __p1_752; \
59724 int32x2_t __rev1_752; __rev1_752 = __builtin_shufflevector(__s1_752, __s1_752, 1, 0); \
59725 __ret_752 = vqdmulls_s32(__s0_752, __noswap_vget_lane_s32(__rev1_752, __p2_752)); \
59726 __ret_752; \
59502#define vst2q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
59503 poly64x2x2_t __s1 = __p1; \
59504 poly64x2x2_t __rev1; \
59505 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59506 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59507 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 38); \
5972759508})
5972859509#endif
5972959510
5973059511#ifdef __LITTLE_ENDIAN__
59731#define vqdmullh_lane_s16(__p0_753, __p1_753, __p2_753) __extension__ ({ \
59732 int32_t __ret_753; \
59733 int16_t __s0_753 = __p0_753; \
59734 int16x4_t __s1_753 = __p1_753; \
59735 __ret_753 = vqdmullh_s16(__s0_753, vget_lane_s16(__s1_753, __p2_753)); \
59736 __ret_753; \
59512#define vst2q_lane_u8(__p0, __p1, __p2) __extension__ ({ \
59513 uint8x16x2_t __s1 = __p1; \
59514 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 48); \
5973759515})
5973859516#else
59739#define vqdmullh_lane_s16(__p0_754, __p1_754, __p2_754) __extension__ ({ \
59740 int32_t __ret_754; \
59741 int16_t __s0_754 = __p0_754; \
59742 int16x4_t __s1_754 = __p1_754; \
59743 int16x4_t __rev1_754; __rev1_754 = __builtin_shufflevector(__s1_754, __s1_754, 3, 2, 1, 0); \
59744 __ret_754 = vqdmullh_s16(__s0_754, __noswap_vget_lane_s16(__rev1_754, __p2_754)); \
59745 __ret_754; \
59517#define vst2q_lane_u8(__p0, __p1, __p2) __extension__ ({ \
59518 uint8x16x2_t __s1 = __p1; \
59519 uint8x16x2_t __rev1; \
59520 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
59521 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
59522 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 48); \
5974659523})
5974759524#endif
5974859525
5974959526#ifdef __LITTLE_ENDIAN__
59750#define vqdmulls_laneq_s32(__p0_755, __p1_755, __p2_755) __extension__ ({ \
59751 int64_t __ret_755; \
59752 int32_t __s0_755 = __p0_755; \
59753 int32x4_t __s1_755 = __p1_755; \
59754 __ret_755 = vqdmulls_s32(__s0_755, vgetq_lane_s32(__s1_755, __p2_755)); \
59755 __ret_755; \
59527#define vst2q_lane_u64(__p0, __p1, __p2) __extension__ ({ \
59528 uint64x2x2_t __s1 = __p1; \
59529 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 51); \
5975659530})
5975759531#else
59758#define vqdmulls_laneq_s32(__p0_756, __p1_756, __p2_756) __extension__ ({ \
59759 int64_t __ret_756; \
59760 int32_t __s0_756 = __p0_756; \
59761 int32x4_t __s1_756 = __p1_756; \
59762 int32x4_t __rev1_756; __rev1_756 = __builtin_shufflevector(__s1_756, __s1_756, 3, 2, 1, 0); \
59763 __ret_756 = vqdmulls_s32(__s0_756, __noswap_vgetq_lane_s32(__rev1_756, __p2_756)); \
59764 __ret_756; \
59532#define vst2q_lane_u64(__p0, __p1, __p2) __extension__ ({ \
59533 uint64x2x2_t __s1 = __p1; \
59534 uint64x2x2_t __rev1; \
59535 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59536 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59537 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 51); \
5976559538})
5976659539#endif
5976759540
5976859541#ifdef __LITTLE_ENDIAN__
59769#define vqdmullh_laneq_s16(__p0_757, __p1_757, __p2_757) __extension__ ({ \
59770 int32_t __ret_757; \
59771 int16_t __s0_757 = __p0_757; \
59772 int16x8_t __s1_757 = __p1_757; \
59773 __ret_757 = vqdmullh_s16(__s0_757, vgetq_lane_s16(__s1_757, __p2_757)); \
59774 __ret_757; \
59542#define vst2q_lane_s8(__p0, __p1, __p2) __extension__ ({ \
59543 int8x16x2_t __s1 = __p1; \
59544 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 32); \
5977559545})
5977659546#else
59777#define vqdmullh_laneq_s16(__p0_758, __p1_758, __p2_758) __extension__ ({ \
59778 int32_t __ret_758; \
59779 int16_t __s0_758 = __p0_758; \
59780 int16x8_t __s1_758 = __p1_758; \
59781 int16x8_t __rev1_758; __rev1_758 = __builtin_shufflevector(__s1_758, __s1_758, 7, 6, 5, 4, 3, 2, 1, 0); \
59782 __ret_758 = vqdmullh_s16(__s0_758, __noswap_vgetq_lane_s16(__rev1_758, __p2_758)); \
59783 __ret_758; \
59547#define vst2q_lane_s8(__p0, __p1, __p2) __extension__ ({ \
59548 int8x16x2_t __s1 = __p1; \
59549 int8x16x2_t __rev1; \
59550 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
59551 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
59552 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 32); \
5978459553})
5978559554#endif
5978659555
5978759556#ifdef __LITTLE_ENDIAN__
59788#define vqdmull_laneq_s32(__p0_759, __p1_759, __p2_759) __extension__ ({ \
59789 int64x2_t __ret_759; \
59790 int32x2_t __s0_759 = __p0_759; \
59791 int32x4_t __s1_759 = __p1_759; \
59792 __ret_759 = vqdmull_s32(__s0_759, splat_laneq_s32(__s1_759, __p2_759)); \
59793 __ret_759; \
59557#define vst2q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
59558 float64x2x2_t __s1 = __p1; \
59559 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 42); \
5979459560})
5979559561#else
59796#define vqdmull_laneq_s32(__p0_760, __p1_760, __p2_760) __extension__ ({ \
59797 int64x2_t __ret_760; \
59798 int32x2_t __s0_760 = __p0_760; \
59799 int32x4_t __s1_760 = __p1_760; \
59800 int32x2_t __rev0_760; __rev0_760 = __builtin_shufflevector(__s0_760, __s0_760, 1, 0); \
59801 int32x4_t __rev1_760; __rev1_760 = __builtin_shufflevector(__s1_760, __s1_760, 3, 2, 1, 0); \
59802 __ret_760 = __noswap_vqdmull_s32(__rev0_760, __noswap_splat_laneq_s32(__rev1_760, __p2_760)); \
59803 __ret_760 = __builtin_shufflevector(__ret_760, __ret_760, 1, 0); \
59804 __ret_760; \
59562#define vst2q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
59563 float64x2x2_t __s1 = __p1; \
59564 float64x2x2_t __rev1; \
59565 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59566 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59567 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 42); \
5980559568})
5980659569#endif
5980759570
5980859571#ifdef __LITTLE_ENDIAN__
59809#define vqdmull_laneq_s16(__p0_761, __p1_761, __p2_761) __extension__ ({ \
59810 int32x4_t __ret_761; \
59811 int16x4_t __s0_761 = __p0_761; \
59812 int16x8_t __s1_761 = __p1_761; \
59813 __ret_761 = vqdmull_s16(__s0_761, splat_laneq_s16(__s1_761, __p2_761)); \
59814 __ret_761; \
59572#define vst2q_lane_s64(__p0, __p1, __p2) __extension__ ({ \
59573 int64x2x2_t __s1 = __p1; \
59574 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 35); \
5981559575})
5981659576#else
59817#define vqdmull_laneq_s16(__p0_762, __p1_762, __p2_762) __extension__ ({ \
59818 int32x4_t __ret_762; \
59819 int16x4_t __s0_762 = __p0_762; \
59820 int16x8_t __s1_762 = __p1_762; \
59821 int16x4_t __rev0_762; __rev0_762 = __builtin_shufflevector(__s0_762, __s0_762, 3, 2, 1, 0); \
59822 int16x8_t __rev1_762; __rev1_762 = __builtin_shufflevector(__s1_762, __s1_762, 7, 6, 5, 4, 3, 2, 1, 0); \
59823 __ret_762 = __noswap_vqdmull_s16(__rev0_762, __noswap_splat_laneq_s16(__rev1_762, __p2_762)); \
59824 __ret_762 = __builtin_shufflevector(__ret_762, __ret_762, 3, 2, 1, 0); \
59825 __ret_762; \
59577#define vst2q_lane_s64(__p0, __p1, __p2) __extension__ ({ \
59578 int64x2x2_t __s1 = __p1; \
59579 int64x2x2_t __rev1; \
59580 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59581 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59582 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 35); \
5982659583})
5982759584#endif
5982859585
59829__ai int16_t vqmovns_s32(int32_t __p0) {
59830 int16_t __ret;
59831 __ret = (int16_t) __builtin_neon_vqmovns_s32(__p0);
59832 return __ret;
59833}
59834__ai int32_t vqmovnd_s64(int64_t __p0) {
59835 int32_t __ret;
59836 __ret = (int32_t) __builtin_neon_vqmovnd_s64(__p0);
59837 return __ret;
59838}
59839__ai int8_t vqmovnh_s16(int16_t __p0) {
59840 int8_t __ret;
59841 __ret = (int8_t) __builtin_neon_vqmovnh_s16(__p0);
59842 return __ret;
59843}
59844__ai uint16_t vqmovns_u32(uint32_t __p0) {
59845 uint16_t __ret;
59846 __ret = (uint16_t) __builtin_neon_vqmovns_u32(__p0);
59847 return __ret;
59848}
59849__ai uint32_t vqmovnd_u64(uint64_t __p0) {
59850 uint32_t __ret;
59851 __ret = (uint32_t) __builtin_neon_vqmovnd_u64(__p0);
59852 return __ret;
59853}
59854__ai uint8_t vqmovnh_u16(uint16_t __p0) {
59855 uint8_t __ret;
59856 __ret = (uint8_t) __builtin_neon_vqmovnh_u16(__p0);
59857 return __ret;
59858}
59586#define vst2_lane_u64(__p0, __p1, __p2) __extension__ ({ \
59587 uint64x1x2_t __s1 = __p1; \
59588 __builtin_neon_vst2_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], __p2, 19); \
59589})
59590#define vst2_lane_f64(__p0, __p1, __p2) __extension__ ({ \
59591 float64x1x2_t __s1 = __p1; \
59592 __builtin_neon_vst2_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], __p2, 10); \
59593})
59594#define vst2_lane_s64(__p0, __p1, __p2) __extension__ ({ \
59595 int64x1x2_t __s1 = __p1; \
59596 __builtin_neon_vst2_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], __p2, 3); \
59597})
59598#define vst3_p64(__p0, __p1) __extension__ ({ \
59599 poly64x1x3_t __s1 = __p1; \
59600 __builtin_neon_vst3_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], 6); \
59601})
5985959602#ifdef __LITTLE_ENDIAN__
59860__ai uint16x8_t vqmovn_high_u32(uint16x4_t __p0, uint32x4_t __p1) {
59861 uint16x8_t __ret;
59862 __ret = vcombine_u16(__p0, vqmovn_u32(__p1));
59863 return __ret;
59864}
59603#define vst3q_p64(__p0, __p1) __extension__ ({ \
59604 poly64x2x3_t __s1 = __p1; \
59605 __builtin_neon_vst3q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], 38); \
59606})
5986559607#else
59866__ai uint16x8_t vqmovn_high_u32(uint16x4_t __p0, uint32x4_t __p1) {
59867 uint16x8_t __ret;
59868 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
59869 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
59870 __ret = __noswap_vcombine_u16(__rev0, __noswap_vqmovn_u32(__rev1));
59871 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
59872 return __ret;
59873}
59608#define vst3q_p64(__p0, __p1) __extension__ ({ \
59609 poly64x2x3_t __s1 = __p1; \
59610 poly64x2x3_t __rev1; \
59611 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59612 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59613 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
59614 __builtin_neon_vst3q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], 38); \
59615})
5987459616#endif
5987559617
5987659618#ifdef __LITTLE_ENDIAN__
59877__ai uint32x4_t vqmovn_high_u64(uint32x2_t __p0, uint64x2_t __p1) {
59878 uint32x4_t __ret;
59879 __ret = vcombine_u32(__p0, vqmovn_u64(__p1));
59880 return __ret;
59881}
59619#define vst3q_u64(__p0, __p1) __extension__ ({ \
59620 uint64x2x3_t __s1 = __p1; \
59621 __builtin_neon_vst3q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], 51); \
59622})
5988259623#else
59883__ai uint32x4_t vqmovn_high_u64(uint32x2_t __p0, uint64x2_t __p1) {
59884 uint32x4_t __ret;
59885 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
59886 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
59887 __ret = __noswap_vcombine_u32(__rev0, __noswap_vqmovn_u64(__rev1));
59888 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
59889 return __ret;
59890}
59624#define vst3q_u64(__p0, __p1) __extension__ ({ \
59625 uint64x2x3_t __s1 = __p1; \
59626 uint64x2x3_t __rev1; \
59627 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59628 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59629 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
59630 __builtin_neon_vst3q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], 51); \
59631})
5989159632#endif
5989259633
5989359634#ifdef __LITTLE_ENDIAN__
59894__ai uint8x16_t vqmovn_high_u16(uint8x8_t __p0, uint16x8_t __p1) {
59895 uint8x16_t __ret;
59896 __ret = vcombine_u8(__p0, vqmovn_u16(__p1));
59897 return __ret;
59898}
59635#define vst3q_f64(__p0, __p1) __extension__ ({ \
59636 float64x2x3_t __s1 = __p1; \
59637 __builtin_neon_vst3q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], 42); \
59638})
5989959639#else
59900__ai uint8x16_t vqmovn_high_u16(uint8x8_t __p0, uint16x8_t __p1) {
59901 uint8x16_t __ret;
59902 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
59903 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
59904 __ret = __noswap_vcombine_u8(__rev0, __noswap_vqmovn_u16(__rev1));
59905 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
59906 return __ret;
59907}
59640#define vst3q_f64(__p0, __p1) __extension__ ({ \
59641 float64x2x3_t __s1 = __p1; \
59642 float64x2x3_t __rev1; \
59643 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59644 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59645 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
59646 __builtin_neon_vst3q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], 42); \
59647})
5990859648#endif
5990959649
5991059650#ifdef __LITTLE_ENDIAN__
59911__ai int16x8_t vqmovn_high_s32(int16x4_t __p0, int32x4_t __p1) {
59912 int16x8_t __ret;
59913 __ret = vcombine_s16(__p0, vqmovn_s32(__p1));
59914 return __ret;
59915}
59651#define vst3q_s64(__p0, __p1) __extension__ ({ \
59652 int64x2x3_t __s1 = __p1; \
59653 __builtin_neon_vst3q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], 35); \
59654})
5991659655#else
59917__ai int16x8_t vqmovn_high_s32(int16x4_t __p0, int32x4_t __p1) {
59918 int16x8_t __ret;
59919 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
59920 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
59921 __ret = __noswap_vcombine_s16(__rev0, __noswap_vqmovn_s32(__rev1));
59922 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
59923 return __ret;
59924}
59656#define vst3q_s64(__p0, __p1) __extension__ ({ \
59657 int64x2x3_t __s1 = __p1; \
59658 int64x2x3_t __rev1; \
59659 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59660 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59661 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
59662 __builtin_neon_vst3q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], 35); \
59663})
5992559664#endif
5992659665
59666#define vst3_f64(__p0, __p1) __extension__ ({ \
59667 float64x1x3_t __s1 = __p1; \
59668 __builtin_neon_vst3_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], 10); \
59669})
59670#define vst3_lane_p64(__p0, __p1, __p2) __extension__ ({ \
59671 poly64x1x3_t __s1 = __p1; \
59672 __builtin_neon_vst3_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], __p2, 6); \
59673})
5992759674#ifdef __LITTLE_ENDIAN__
59928__ai int32x4_t vqmovn_high_s64(int32x2_t __p0, int64x2_t __p1) {
59929 int32x4_t __ret;
59930 __ret = vcombine_s32(__p0, vqmovn_s64(__p1));
59931 return __ret;
59932}
59675#define vst3q_lane_p8(__p0, __p1, __p2) __extension__ ({ \
59676 poly8x16x3_t __s1 = __p1; \
59677 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 36); \
59678})
5993359679#else
59934__ai int32x4_t vqmovn_high_s64(int32x2_t __p0, int64x2_t __p1) {
59935 int32x4_t __ret;
59936 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
59937 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
59938 __ret = __noswap_vcombine_s32(__rev0, __noswap_vqmovn_s64(__rev1));
59939 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
59940 return __ret;
59941}
59680#define vst3q_lane_p8(__p0, __p1, __p2) __extension__ ({ \
59681 poly8x16x3_t __s1 = __p1; \
59682 poly8x16x3_t __rev1; \
59683 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
59684 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
59685 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
59686 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 36); \
59687})
5994259688#endif
5994359689
5994459690#ifdef __LITTLE_ENDIAN__
59945__ai int8x16_t vqmovn_high_s16(int8x8_t __p0, int16x8_t __p1) {
59946 int8x16_t __ret;
59947 __ret = vcombine_s8(__p0, vqmovn_s16(__p1));
59948 return __ret;
59949}
59691#define vst3q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
59692 poly64x2x3_t __s1 = __p1; \
59693 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 38); \
59694})
5995059695#else
59951__ai int8x16_t vqmovn_high_s16(int8x8_t __p0, int16x8_t __p1) {
59952 int8x16_t __ret;
59953 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
59954 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
59955 __ret = __noswap_vcombine_s8(__rev0, __noswap_vqmovn_s16(__rev1));
59956 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
59957 return __ret;
59958}
59696#define vst3q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
59697 poly64x2x3_t __s1 = __p1; \
59698 poly64x2x3_t __rev1; \
59699 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59700 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59701 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
59702 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 38); \
59703})
5995959704#endif
5996059705
59961__ai uint16_t vqmovuns_s32(int32_t __p0) {
59962 uint16_t __ret;
59963 __ret = (uint16_t) __builtin_neon_vqmovuns_s32(__p0);
59964 return __ret;
59965}
59966__ai uint32_t vqmovund_s64(int64_t __p0) {
59967 uint32_t __ret;
59968 __ret = (uint32_t) __builtin_neon_vqmovund_s64(__p0);
59969 return __ret;
59970}
59971__ai uint8_t vqmovunh_s16(int16_t __p0) {
59972 uint8_t __ret;
59973 __ret = (uint8_t) __builtin_neon_vqmovunh_s16(__p0);
59974 return __ret;
59975}
5997659706#ifdef __LITTLE_ENDIAN__
59977__ai uint16x8_t vqmovun_high_s32(uint16x4_t __p0, int32x4_t __p1) {
59978 uint16x8_t __ret;
59979 __ret = vcombine_u16((uint16x4_t)(__p0), vqmovun_s32(__p1));
59980 return __ret;
59981}
59707#define vst3q_lane_u8(__p0, __p1, __p2) __extension__ ({ \
59708 uint8x16x3_t __s1 = __p1; \
59709 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 48); \
59710})
5998259711#else
59983__ai uint16x8_t vqmovun_high_s32(uint16x4_t __p0, int32x4_t __p1) {
59984 uint16x8_t __ret;
59985 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
59986 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
59987 __ret = __noswap_vcombine_u16((uint16x4_t)(__rev0), __noswap_vqmovun_s32(__rev1));
59988 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
59989 return __ret;
59990}
59712#define vst3q_lane_u8(__p0, __p1, __p2) __extension__ ({ \
59713 uint8x16x3_t __s1 = __p1; \
59714 uint8x16x3_t __rev1; \
59715 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
59716 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
59717 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
59718 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 48); \
59719})
5999159720#endif
5999259721
5999359722#ifdef __LITTLE_ENDIAN__
59994__ai uint32x4_t vqmovun_high_s64(uint32x2_t __p0, int64x2_t __p1) {
59995 uint32x4_t __ret;
59996 __ret = vcombine_u32((uint32x2_t)(__p0), vqmovun_s64(__p1));
59997 return __ret;
59998}
59723#define vst3q_lane_u64(__p0, __p1, __p2) __extension__ ({ \
59724 uint64x2x3_t __s1 = __p1; \
59725 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 51); \
59726})
5999959727#else
60000__ai uint32x4_t vqmovun_high_s64(uint32x2_t __p0, int64x2_t __p1) {
60001 uint32x4_t __ret;
60002 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
60003 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
60004 __ret = __noswap_vcombine_u32((uint32x2_t)(__rev0), __noswap_vqmovun_s64(__rev1));
60005 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
60006 return __ret;
60007}
59728#define vst3q_lane_u64(__p0, __p1, __p2) __extension__ ({ \
59729 uint64x2x3_t __s1 = __p1; \
59730 uint64x2x3_t __rev1; \
59731 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59732 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59733 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
59734 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 51); \
59735})
6000859736#endif
6000959737
6001059738#ifdef __LITTLE_ENDIAN__
60011__ai uint8x16_t vqmovun_high_s16(uint8x8_t __p0, int16x8_t __p1) {
60012 uint8x16_t __ret;
60013 __ret = vcombine_u8((uint8x8_t)(__p0), vqmovun_s16(__p1));
60014 return __ret;
60015}
59739#define vst3q_lane_s8(__p0, __p1, __p2) __extension__ ({ \
59740 int8x16x3_t __s1 = __p1; \
59741 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 32); \
59742})
6001659743#else
60017__ai uint8x16_t vqmovun_high_s16(uint8x8_t __p0, int16x8_t __p1) {
60018 uint8x16_t __ret;
60019 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
60020 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
60021 __ret = __noswap_vcombine_u8((uint8x8_t)(__rev0), __noswap_vqmovun_s16(__rev1));
60022 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60023 return __ret;
60024}
59744#define vst3q_lane_s8(__p0, __p1, __p2) __extension__ ({ \
59745 int8x16x3_t __s1 = __p1; \
59746 int8x16x3_t __rev1; \
59747 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
59748 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
59749 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
59750 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 32); \
59751})
6002559752#endif
6002659753
6002759754#ifdef __LITTLE_ENDIAN__
60028__ai int64x2_t vqnegq_s64(int64x2_t __p0) {
60029 int64x2_t __ret;
60030 __ret = (int64x2_t) __builtin_neon_vqnegq_v((int8x16_t)__p0, 35);
60031 return __ret;
60032}
59755#define vst3q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
59756 float64x2x3_t __s1 = __p1; \
59757 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 42); \
59758})
6003359759#else
60034__ai int64x2_t vqnegq_s64(int64x2_t __p0) {
60035 int64x2_t __ret;
60036 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
60037 __ret = (int64x2_t) __builtin_neon_vqnegq_v((int8x16_t)__rev0, 35);
60038 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
60039 return __ret;
60040}
60041#endif
60042
60043__ai int64x1_t vqneg_s64(int64x1_t __p0) {
60044 int64x1_t __ret;
60045 __ret = (int64x1_t) __builtin_neon_vqneg_v((int8x8_t)__p0, 3);
60046 return __ret;
60047}
60048__ai int8_t vqnegb_s8(int8_t __p0) {
60049 int8_t __ret;
60050 __ret = (int8_t) __builtin_neon_vqnegb_s8(__p0);
60051 return __ret;
60052}
60053__ai int32_t vqnegs_s32(int32_t __p0) {
60054 int32_t __ret;
60055 __ret = (int32_t) __builtin_neon_vqnegs_s32(__p0);
60056 return __ret;
60057}
60058__ai int64_t vqnegd_s64(int64_t __p0) {
60059 int64_t __ret;
60060 __ret = (int64_t) __builtin_neon_vqnegd_s64(__p0);
60061 return __ret;
60062}
60063__ai int16_t vqnegh_s16(int16_t __p0) {
60064 int16_t __ret;
60065 __ret = (int16_t) __builtin_neon_vqnegh_s16(__p0);
60066 return __ret;
60067}
60068__ai int32_t vqrdmulhs_s32(int32_t __p0, int32_t __p1) {
60069 int32_t __ret;
60070 __ret = (int32_t) __builtin_neon_vqrdmulhs_s32(__p0, __p1);
60071 return __ret;
60072}
60073__ai int16_t vqrdmulhh_s16(int16_t __p0, int16_t __p1) {
60074 int16_t __ret;
60075 __ret = (int16_t) __builtin_neon_vqrdmulhh_s16(__p0, __p1);
60076 return __ret;
60077}
59760#define vst3q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
59761 float64x2x3_t __s1 = __p1; \
59762 float64x2x3_t __rev1; \
59763 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59764 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59765 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
59766 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 42); \
59767})
59768#endif
59769
6007859770#ifdef __LITTLE_ENDIAN__
60079#define vqrdmulhq_lane_s32(__p0, __p1, __p2) __extension__ ({ \
60080 int32x4_t __ret; \
60081 int32x4_t __s0 = __p0; \
60082 int32x2_t __s1 = __p1; \
60083 __ret = (int32x4_t) __builtin_neon_vqrdmulhq_lane_v((int8x16_t)__s0, (int8x8_t)__s1, __p2, 2); \
60084 __ret; \
59771#define vst3q_lane_s64(__p0, __p1, __p2) __extension__ ({ \
59772 int64x2x3_t __s1 = __p1; \
59773 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 35); \
6008559774})
6008659775#else
60087#define vqrdmulhq_lane_s32(__p0, __p1, __p2) __extension__ ({ \
60088 int32x4_t __ret; \
60089 int32x4_t __s0 = __p0; \
60090 int32x2_t __s1 = __p1; \
60091 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
60092 int32x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
60093 __ret = (int32x4_t) __builtin_neon_vqrdmulhq_lane_v((int8x16_t)__rev0, (int8x8_t)__rev1, __p2, 2); \
60094 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
60095 __ret; \
59776#define vst3q_lane_s64(__p0, __p1, __p2) __extension__ ({ \
59777 int64x2x3_t __s1 = __p1; \
59778 int64x2x3_t __rev1; \
59779 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59780 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59781 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
59782 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 35); \
6009659783})
6009759784#endif
6009859785
59786#define vst3_lane_u64(__p0, __p1, __p2) __extension__ ({ \
59787 uint64x1x3_t __s1 = __p1; \
59788 __builtin_neon_vst3_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], __p2, 19); \
59789})
59790#define vst3_lane_f64(__p0, __p1, __p2) __extension__ ({ \
59791 float64x1x3_t __s1 = __p1; \
59792 __builtin_neon_vst3_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], __p2, 10); \
59793})
59794#define vst3_lane_s64(__p0, __p1, __p2) __extension__ ({ \
59795 int64x1x3_t __s1 = __p1; \
59796 __builtin_neon_vst3_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], __p2, 3); \
59797})
59798#define vst4_p64(__p0, __p1) __extension__ ({ \
59799 poly64x1x4_t __s1 = __p1; \
59800 __builtin_neon_vst4_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], 6); \
59801})
6009959802#ifdef __LITTLE_ENDIAN__
60100#define vqrdmulhq_lane_s16(__p0, __p1, __p2) __extension__ ({ \
60101 int16x8_t __ret; \
60102 int16x8_t __s0 = __p0; \
60103 int16x4_t __s1 = __p1; \
60104 __ret = (int16x8_t) __builtin_neon_vqrdmulhq_lane_v((int8x16_t)__s0, (int8x8_t)__s1, __p2, 1); \
60105 __ret; \
59803#define vst4q_p64(__p0, __p1) __extension__ ({ \
59804 poly64x2x4_t __s1 = __p1; \
59805 __builtin_neon_vst4q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], 38); \
6010659806})
6010759807#else
60108#define vqrdmulhq_lane_s16(__p0, __p1, __p2) __extension__ ({ \
60109 int16x8_t __ret; \
60110 int16x8_t __s0 = __p0; \
60111 int16x4_t __s1 = __p1; \
60112 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
60113 int16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
60114 __ret = (int16x8_t) __builtin_neon_vqrdmulhq_lane_v((int8x16_t)__rev0, (int8x8_t)__rev1, __p2, 1); \
60115 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
60116 __ret; \
59808#define vst4q_p64(__p0, __p1) __extension__ ({ \
59809 poly64x2x4_t __s1 = __p1; \
59810 poly64x2x4_t __rev1; \
59811 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59812 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59813 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
59814 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 1, 0); \
59815 __builtin_neon_vst4q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], 38); \
6011759816})
6011859817#endif
6011959818
6012059819#ifdef __LITTLE_ENDIAN__
60121#define vqrdmulh_lane_s32(__p0, __p1, __p2) __extension__ ({ \
60122 int32x2_t __ret; \
60123 int32x2_t __s0 = __p0; \
60124 int32x2_t __s1 = __p1; \
60125 __ret = (int32x2_t) __builtin_neon_vqrdmulh_lane_v((int8x8_t)__s0, (int8x8_t)__s1, __p2, 2); \
60126 __ret; \
59820#define vst4q_u64(__p0, __p1) __extension__ ({ \
59821 uint64x2x4_t __s1 = __p1; \
59822 __builtin_neon_vst4q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], 51); \
6012759823})
6012859824#else
60129#define vqrdmulh_lane_s32(__p0, __p1, __p2) __extension__ ({ \
60130 int32x2_t __ret; \
60131 int32x2_t __s0 = __p0; \
60132 int32x2_t __s1 = __p1; \
60133 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
60134 int32x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
60135 __ret = (int32x2_t) __builtin_neon_vqrdmulh_lane_v((int8x8_t)__rev0, (int8x8_t)__rev1, __p2, 2); \
60136 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
60137 __ret; \
59825#define vst4q_u64(__p0, __p1) __extension__ ({ \
59826 uint64x2x4_t __s1 = __p1; \
59827 uint64x2x4_t __rev1; \
59828 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59829 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59830 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
59831 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 1, 0); \
59832 __builtin_neon_vst4q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], 51); \
6013859833})
6013959834#endif
6014059835
6014159836#ifdef __LITTLE_ENDIAN__
60142#define vqrdmulh_lane_s16(__p0, __p1, __p2) __extension__ ({ \
60143 int16x4_t __ret; \
60144 int16x4_t __s0 = __p0; \
60145 int16x4_t __s1 = __p1; \
60146 __ret = (int16x4_t) __builtin_neon_vqrdmulh_lane_v((int8x8_t)__s0, (int8x8_t)__s1, __p2, 1); \
60147 __ret; \
59837#define vst4q_f64(__p0, __p1) __extension__ ({ \
59838 float64x2x4_t __s1 = __p1; \
59839 __builtin_neon_vst4q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], 42); \
6014859840})
6014959841#else
60150#define vqrdmulh_lane_s16(__p0, __p1, __p2) __extension__ ({ \
60151 int16x4_t __ret; \
60152 int16x4_t __s0 = __p0; \
60153 int16x4_t __s1 = __p1; \
60154 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
60155 int16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
60156 __ret = (int16x4_t) __builtin_neon_vqrdmulh_lane_v((int8x8_t)__rev0, (int8x8_t)__rev1, __p2, 1); \
60157 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
60158 __ret; \
59842#define vst4q_f64(__p0, __p1) __extension__ ({ \
59843 float64x2x4_t __s1 = __p1; \
59844 float64x2x4_t __rev1; \
59845 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59846 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59847 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
59848 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 1, 0); \
59849 __builtin_neon_vst4q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], 42); \
6015959850})
6016059851#endif
6016159852
6016259853#ifdef __LITTLE_ENDIAN__
60163#define vqrdmulhs_lane_s32(__p0_763, __p1_763, __p2_763) __extension__ ({ \
60164 int32_t __ret_763; \
60165 int32_t __s0_763 = __p0_763; \
60166 int32x2_t __s1_763 = __p1_763; \
60167 __ret_763 = vqrdmulhs_s32(__s0_763, vget_lane_s32(__s1_763, __p2_763)); \
60168 __ret_763; \
59854#define vst4q_s64(__p0, __p1) __extension__ ({ \
59855 int64x2x4_t __s1 = __p1; \
59856 __builtin_neon_vst4q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], 35); \
6016959857})
6017059858#else
60171#define vqrdmulhs_lane_s32(__p0_764, __p1_764, __p2_764) __extension__ ({ \
60172 int32_t __ret_764; \
60173 int32_t __s0_764 = __p0_764; \
60174 int32x2_t __s1_764 = __p1_764; \
60175 int32x2_t __rev1_764; __rev1_764 = __builtin_shufflevector(__s1_764, __s1_764, 1, 0); \
60176 __ret_764 = vqrdmulhs_s32(__s0_764, __noswap_vget_lane_s32(__rev1_764, __p2_764)); \
60177 __ret_764; \
59859#define vst4q_s64(__p0, __p1) __extension__ ({ \
59860 int64x2x4_t __s1 = __p1; \
59861 int64x2x4_t __rev1; \
59862 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59863 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59864 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
59865 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 1, 0); \
59866 __builtin_neon_vst4q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], 35); \
6017859867})
6017959868#endif
6018059869
59870#define vst4_f64(__p0, __p1) __extension__ ({ \
59871 float64x1x4_t __s1 = __p1; \
59872 __builtin_neon_vst4_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], 10); \
59873})
59874#define vst4_lane_p64(__p0, __p1, __p2) __extension__ ({ \
59875 poly64x1x4_t __s1 = __p1; \
59876 __builtin_neon_vst4_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], __p2, 6); \
59877})
6018159878#ifdef __LITTLE_ENDIAN__
60182#define vqrdmulhh_lane_s16(__p0_765, __p1_765, __p2_765) __extension__ ({ \
60183 int16_t __ret_765; \
60184 int16_t __s0_765 = __p0_765; \
60185 int16x4_t __s1_765 = __p1_765; \
60186 __ret_765 = vqrdmulhh_s16(__s0_765, vget_lane_s16(__s1_765, __p2_765)); \
60187 __ret_765; \
59879#define vst4q_lane_p8(__p0, __p1, __p2) __extension__ ({ \
59880 poly8x16x4_t __s1 = __p1; \
59881 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 36); \
6018859882})
6018959883#else
60190#define vqrdmulhh_lane_s16(__p0_766, __p1_766, __p2_766) __extension__ ({ \
60191 int16_t __ret_766; \
60192 int16_t __s0_766 = __p0_766; \
60193 int16x4_t __s1_766 = __p1_766; \
60194 int16x4_t __rev1_766; __rev1_766 = __builtin_shufflevector(__s1_766, __s1_766, 3, 2, 1, 0); \
60195 __ret_766 = vqrdmulhh_s16(__s0_766, __noswap_vget_lane_s16(__rev1_766, __p2_766)); \
60196 __ret_766; \
59884#define vst4q_lane_p8(__p0, __p1, __p2) __extension__ ({ \
59885 poly8x16x4_t __s1 = __p1; \
59886 poly8x16x4_t __rev1; \
59887 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
59888 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
59889 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
59890 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
59891 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 36); \
6019759892})
6019859893#endif
6019959894
6020059895#ifdef __LITTLE_ENDIAN__
60201#define vqrdmulhs_laneq_s32(__p0_767, __p1_767, __p2_767) __extension__ ({ \
60202 int32_t __ret_767; \
60203 int32_t __s0_767 = __p0_767; \
60204 int32x4_t __s1_767 = __p1_767; \
60205 __ret_767 = vqrdmulhs_s32(__s0_767, vgetq_lane_s32(__s1_767, __p2_767)); \
60206 __ret_767; \
59896#define vst4q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
59897 poly64x2x4_t __s1 = __p1; \
59898 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 38); \
6020759899})
6020859900#else
60209#define vqrdmulhs_laneq_s32(__p0_768, __p1_768, __p2_768) __extension__ ({ \
60210 int32_t __ret_768; \
60211 int32_t __s0_768 = __p0_768; \
60212 int32x4_t __s1_768 = __p1_768; \
60213 int32x4_t __rev1_768; __rev1_768 = __builtin_shufflevector(__s1_768, __s1_768, 3, 2, 1, 0); \
60214 __ret_768 = vqrdmulhs_s32(__s0_768, __noswap_vgetq_lane_s32(__rev1_768, __p2_768)); \
60215 __ret_768; \
59901#define vst4q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
59902 poly64x2x4_t __s1 = __p1; \
59903 poly64x2x4_t __rev1; \
59904 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59905 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59906 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
59907 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 1, 0); \
59908 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 38); \
6021659909})
6021759910#endif
6021859911
6021959912#ifdef __LITTLE_ENDIAN__
60220#define vqrdmulhh_laneq_s16(__p0_769, __p1_769, __p2_769) __extension__ ({ \
60221 int16_t __ret_769; \
60222 int16_t __s0_769 = __p0_769; \
60223 int16x8_t __s1_769 = __p1_769; \
60224 __ret_769 = vqrdmulhh_s16(__s0_769, vgetq_lane_s16(__s1_769, __p2_769)); \
60225 __ret_769; \
59913#define vst4q_lane_u8(__p0, __p1, __p2) __extension__ ({ \
59914 uint8x16x4_t __s1 = __p1; \
59915 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 48); \
6022659916})
6022759917#else
60228#define vqrdmulhh_laneq_s16(__p0_770, __p1_770, __p2_770) __extension__ ({ \
60229 int16_t __ret_770; \
60230 int16_t __s0_770 = __p0_770; \
60231 int16x8_t __s1_770 = __p1_770; \
60232 int16x8_t __rev1_770; __rev1_770 = __builtin_shufflevector(__s1_770, __s1_770, 7, 6, 5, 4, 3, 2, 1, 0); \
60233 __ret_770 = vqrdmulhh_s16(__s0_770, __noswap_vgetq_lane_s16(__rev1_770, __p2_770)); \
60234 __ret_770; \
59918#define vst4q_lane_u8(__p0, __p1, __p2) __extension__ ({ \
59919 uint8x16x4_t __s1 = __p1; \
59920 uint8x16x4_t __rev1; \
59921 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
59922 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
59923 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
59924 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
59925 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 48); \
6023559926})
6023659927#endif
6023759928
6023859929#ifdef __LITTLE_ENDIAN__
60239#define vqrdmulhq_laneq_s32(__p0, __p1, __p2) __extension__ ({ \
60240 int32x4_t __ret; \
60241 int32x4_t __s0 = __p0; \
60242 int32x4_t __s1 = __p1; \
60243 __ret = (int32x4_t) __builtin_neon_vqrdmulhq_laneq_v((int8x16_t)__s0, (int8x16_t)__s1, __p2, 34); \
60244 __ret; \
59930#define vst4q_lane_u64(__p0, __p1, __p2) __extension__ ({ \
59931 uint64x2x4_t __s1 = __p1; \
59932 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 51); \
6024559933})
6024659934#else
60247#define vqrdmulhq_laneq_s32(__p0, __p1, __p2) __extension__ ({ \
60248 int32x4_t __ret; \
60249 int32x4_t __s0 = __p0; \
60250 int32x4_t __s1 = __p1; \
60251 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
60252 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
60253 __ret = (int32x4_t) __builtin_neon_vqrdmulhq_laneq_v((int8x16_t)__rev0, (int8x16_t)__rev1, __p2, 34); \
60254 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
60255 __ret; \
59935#define vst4q_lane_u64(__p0, __p1, __p2) __extension__ ({ \
59936 uint64x2x4_t __s1 = __p1; \
59937 uint64x2x4_t __rev1; \
59938 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59939 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59940 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
59941 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 1, 0); \
59942 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 51); \
6025659943})
6025759944#endif
6025859945
6025959946#ifdef __LITTLE_ENDIAN__
60260#define vqrdmulhq_laneq_s16(__p0, __p1, __p2) __extension__ ({ \
60261 int16x8_t __ret; \
60262 int16x8_t __s0 = __p0; \
60263 int16x8_t __s1 = __p1; \
60264 __ret = (int16x8_t) __builtin_neon_vqrdmulhq_laneq_v((int8x16_t)__s0, (int8x16_t)__s1, __p2, 33); \
60265 __ret; \
59947#define vst4q_lane_s8(__p0, __p1, __p2) __extension__ ({ \
59948 int8x16x4_t __s1 = __p1; \
59949 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 32); \
6026659950})
6026759951#else
60268#define vqrdmulhq_laneq_s16(__p0, __p1, __p2) __extension__ ({ \
60269 int16x8_t __ret; \
60270 int16x8_t __s0 = __p0; \
60271 int16x8_t __s1 = __p1; \
60272 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
60273 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
60274 __ret = (int16x8_t) __builtin_neon_vqrdmulhq_laneq_v((int8x16_t)__rev0, (int8x16_t)__rev1, __p2, 33); \
60275 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
60276 __ret; \
59952#define vst4q_lane_s8(__p0, __p1, __p2) __extension__ ({ \
59953 int8x16x4_t __s1 = __p1; \
59954 int8x16x4_t __rev1; \
59955 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
59956 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
59957 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
59958 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
59959 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 32); \
6027759960})
6027859961#endif
6027959962
6028059963#ifdef __LITTLE_ENDIAN__
60281#define vqrdmulh_laneq_s32(__p0, __p1, __p2) __extension__ ({ \
60282 int32x2_t __ret; \
60283 int32x2_t __s0 = __p0; \
60284 int32x4_t __s1 = __p1; \
60285 __ret = (int32x2_t) __builtin_neon_vqrdmulh_laneq_v((int8x8_t)__s0, (int8x16_t)__s1, __p2, 2); \
60286 __ret; \
59964#define vst4q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
59965 float64x2x4_t __s1 = __p1; \
59966 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 42); \
6028759967})
6028859968#else
60289#define vqrdmulh_laneq_s32(__p0, __p1, __p2) __extension__ ({ \
60290 int32x2_t __ret; \
60291 int32x2_t __s0 = __p0; \
60292 int32x4_t __s1 = __p1; \
60293 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
60294 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
60295 __ret = (int32x2_t) __builtin_neon_vqrdmulh_laneq_v((int8x8_t)__rev0, (int8x16_t)__rev1, __p2, 2); \
60296 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
60297 __ret; \
59969#define vst4q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
59970 float64x2x4_t __s1 = __p1; \
59971 float64x2x4_t __rev1; \
59972 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59973 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59974 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
59975 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 1, 0); \
59976 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 42); \
6029859977})
6029959978#endif
6030059979
6030159980#ifdef __LITTLE_ENDIAN__
60302#define vqrdmulh_laneq_s16(__p0, __p1, __p2) __extension__ ({ \
60303 int16x4_t __ret; \
60304 int16x4_t __s0 = __p0; \
60305 int16x8_t __s1 = __p1; \
60306 __ret = (int16x4_t) __builtin_neon_vqrdmulh_laneq_v((int8x8_t)__s0, (int8x16_t)__s1, __p2, 1); \
60307 __ret; \
59981#define vst4q_lane_s64(__p0, __p1, __p2) __extension__ ({ \
59982 int64x2x4_t __s1 = __p1; \
59983 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 35); \
6030859984})
6030959985#else
60310#define vqrdmulh_laneq_s16(__p0, __p1, __p2) __extension__ ({ \
60311 int16x4_t __ret; \
60312 int16x4_t __s0 = __p0; \
60313 int16x8_t __s1 = __p1; \
60314 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
60315 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
60316 __ret = (int16x4_t) __builtin_neon_vqrdmulh_laneq_v((int8x8_t)__rev0, (int8x16_t)__rev1, __p2, 1); \
60317 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
60318 __ret; \
59986#define vst4q_lane_s64(__p0, __p1, __p2) __extension__ ({ \
59987 int64x2x4_t __s1 = __p1; \
59988 int64x2x4_t __rev1; \
59989 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
59990 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
59991 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
59992 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 1, 0); \
59993 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 35); \
6031959994})
6032059995#endif
6032159996
60322__ai uint8_t vqrshlb_u8(uint8_t __p0, int8_t __p1) {
60323 uint8_t __ret;
60324 __ret = (uint8_t) __builtin_neon_vqrshlb_u8(__p0, __p1);
59997#define vst4_lane_u64(__p0, __p1, __p2) __extension__ ({ \
59998 uint64x1x4_t __s1 = __p1; \
59999 __builtin_neon_vst4_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], __p2, 19); \
60000})
60001#define vst4_lane_f64(__p0, __p1, __p2) __extension__ ({ \
60002 float64x1x4_t __s1 = __p1; \
60003 __builtin_neon_vst4_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], __p2, 10); \
60004})
60005#define vst4_lane_s64(__p0, __p1, __p2) __extension__ ({ \
60006 int64x1x4_t __s1 = __p1; \
60007 __builtin_neon_vst4_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], __p2, 3); \
60008})
60009#define vstrq_p128(__p0, __p1) __extension__ ({ \
60010 poly128_t __s1 = __p1; \
60011 __builtin_neon_vstrq_p128(__p0, __s1); \
60012})
60013__ai uint64_t vsubd_u64(uint64_t __p0, uint64_t __p1) {
60014 uint64_t __ret;
60015 __ret = (uint64_t) __builtin_neon_vsubd_u64(__p0, __p1);
6032560016 return __ret;
6032660017}
60327__ai uint32_t vqrshls_u32(uint32_t __p0, int32_t __p1) {
60328 uint32_t __ret;
60329 __ret = (uint32_t) __builtin_neon_vqrshls_u32(__p0, __p1);
60018__ai int64_t vsubd_s64(int64_t __p0, int64_t __p1) {
60019 int64_t __ret;
60020 __ret = (int64_t) __builtin_neon_vsubd_s64(__p0, __p1);
6033060021 return __ret;
6033160022}
60332__ai uint64_t vqrshld_u64(uint64_t __p0, int64_t __p1) {
60333 uint64_t __ret;
60334 __ret = (uint64_t) __builtin_neon_vqrshld_u64(__p0, __p1);
60023#ifdef __LITTLE_ENDIAN__
60024__ai float64x2_t vsubq_f64(float64x2_t __p0, float64x2_t __p1) {
60025 float64x2_t __ret;
60026 __ret = __p0 - __p1;
6033560027 return __ret;
6033660028}
60337__ai uint16_t vqrshlh_u16(uint16_t __p0, int16_t __p1) {
60338 uint16_t __ret;
60339 __ret = (uint16_t) __builtin_neon_vqrshlh_u16(__p0, __p1);
60029#else
60030__ai float64x2_t vsubq_f64(float64x2_t __p0, float64x2_t __p1) {
60031 float64x2_t __ret;
60032 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
60033 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
60034 __ret = __rev0 - __rev1;
60035 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6034060036 return __ret;
6034160037}
60342__ai int8_t vqrshlb_s8(int8_t __p0, int8_t __p1) {
60343 int8_t __ret;
60344 __ret = (int8_t) __builtin_neon_vqrshlb_s8(__p0, __p1);
60038#endif
60039
60040__ai float64x1_t vsub_f64(float64x1_t __p0, float64x1_t __p1) {
60041 float64x1_t __ret;
60042 __ret = __p0 - __p1;
6034560043 return __ret;
6034660044}
60347__ai int32_t vqrshls_s32(int32_t __p0, int32_t __p1) {
60348 int32_t __ret;
60349 __ret = (int32_t) __builtin_neon_vqrshls_s32(__p0, __p1);
60045#ifdef __LITTLE_ENDIAN__
60046__ai uint16x8_t vsubhn_high_u32(uint16x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
60047 uint16x8_t __ret;
60048 __ret = vcombine_u16(__p0, vsubhn_u32(__p1, __p2));
6035060049 return __ret;
6035160050}
60352__ai int64_t vqrshld_s64(int64_t __p0, int64_t __p1) {
60353 int64_t __ret;
60354 __ret = (int64_t) __builtin_neon_vqrshld_s64(__p0, __p1);
60051#else
60052__ai uint16x8_t vsubhn_high_u32(uint16x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
60053 uint16x8_t __ret;
60054 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
60055 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
60056 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
60057 __ret = __noswap_vcombine_u16(__rev0, __noswap_vsubhn_u32(__rev1, __rev2));
60058 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6035560059 return __ret;
6035660060}
60357__ai int16_t vqrshlh_s16(int16_t __p0, int16_t __p1) {
60358 int16_t __ret;
60359 __ret = (int16_t) __builtin_neon_vqrshlh_s16(__p0, __p1);
60061#endif
60062
60063#ifdef __LITTLE_ENDIAN__
60064__ai uint32x4_t vsubhn_high_u64(uint32x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
60065 uint32x4_t __ret;
60066 __ret = vcombine_u32(__p0, vsubhn_u64(__p1, __p2));
6036060067 return __ret;
6036160068}
60362#ifdef __LITTLE_ENDIAN__
60363#define vqrshrn_high_n_u32(__p0_771, __p1_771, __p2_771) __extension__ ({ \
60364 uint16x8_t __ret_771; \
60365 uint16x4_t __s0_771 = __p0_771; \
60366 uint32x4_t __s1_771 = __p1_771; \
60367 __ret_771 = (uint16x8_t)(vcombine_u16((uint16x4_t)(__s0_771), (uint16x4_t)(vqrshrn_n_u32(__s1_771, __p2_771)))); \
60368 __ret_771; \
60369})
6037060069#else
60371#define vqrshrn_high_n_u32(__p0_772, __p1_772, __p2_772) __extension__ ({ \
60372 uint16x8_t __ret_772; \
60373 uint16x4_t __s0_772 = __p0_772; \
60374 uint32x4_t __s1_772 = __p1_772; \
60375 uint16x4_t __rev0_772; __rev0_772 = __builtin_shufflevector(__s0_772, __s0_772, 3, 2, 1, 0); \
60376 uint32x4_t __rev1_772; __rev1_772 = __builtin_shufflevector(__s1_772, __s1_772, 3, 2, 1, 0); \
60377 __ret_772 = (uint16x8_t)(__noswap_vcombine_u16((uint16x4_t)(__rev0_772), (uint16x4_t)(__noswap_vqrshrn_n_u32(__rev1_772, __p2_772)))); \
60378 __ret_772 = __builtin_shufflevector(__ret_772, __ret_772, 7, 6, 5, 4, 3, 2, 1, 0); \
60379 __ret_772; \
60380})
60070__ai uint32x4_t vsubhn_high_u64(uint32x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
60071 uint32x4_t __ret;
60072 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
60073 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
60074 uint64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
60075 __ret = __noswap_vcombine_u32(__rev0, __noswap_vsubhn_u64(__rev1, __rev2));
60076 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
60077 return __ret;
60078}
6038160079#endif
6038260080
6038360081#ifdef __LITTLE_ENDIAN__
60384#define vqrshrn_high_n_u64(__p0_773, __p1_773, __p2_773) __extension__ ({ \
60385 uint32x4_t __ret_773; \
60386 uint32x2_t __s0_773 = __p0_773; \
60387 uint64x2_t __s1_773 = __p1_773; \
60388 __ret_773 = (uint32x4_t)(vcombine_u32((uint32x2_t)(__s0_773), (uint32x2_t)(vqrshrn_n_u64(__s1_773, __p2_773)))); \
60389 __ret_773; \
60390})
60082__ai uint8x16_t vsubhn_high_u16(uint8x8_t __p0, uint16x8_t __p1, uint16x8_t __p2) {
60083 uint8x16_t __ret;
60084 __ret = vcombine_u8(__p0, vsubhn_u16(__p1, __p2));
60085 return __ret;
60086}
6039160087#else
60392#define vqrshrn_high_n_u64(__p0_774, __p1_774, __p2_774) __extension__ ({ \
60393 uint32x4_t __ret_774; \
60394 uint32x2_t __s0_774 = __p0_774; \
60395 uint64x2_t __s1_774 = __p1_774; \
60396 uint32x2_t __rev0_774; __rev0_774 = __builtin_shufflevector(__s0_774, __s0_774, 1, 0); \
60397 uint64x2_t __rev1_774; __rev1_774 = __builtin_shufflevector(__s1_774, __s1_774, 1, 0); \
60398 __ret_774 = (uint32x4_t)(__noswap_vcombine_u32((uint32x2_t)(__rev0_774), (uint32x2_t)(__noswap_vqrshrn_n_u64(__rev1_774, __p2_774)))); \
60399 __ret_774 = __builtin_shufflevector(__ret_774, __ret_774, 3, 2, 1, 0); \
60400 __ret_774; \
60401})
60088__ai uint8x16_t vsubhn_high_u16(uint8x8_t __p0, uint16x8_t __p1, uint16x8_t __p2) {
60089 uint8x16_t __ret;
60090 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
60091 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
60092 uint16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
60093 __ret = __noswap_vcombine_u8(__rev0, __noswap_vsubhn_u16(__rev1, __rev2));
60094 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60095 return __ret;
60096}
6040260097#endif
6040360098
6040460099#ifdef __LITTLE_ENDIAN__
60405#define vqrshrn_high_n_u16(__p0_775, __p1_775, __p2_775) __extension__ ({ \
60406 uint8x16_t __ret_775; \
60407 uint8x8_t __s0_775 = __p0_775; \
60408 uint16x8_t __s1_775 = __p1_775; \
60409 __ret_775 = (uint8x16_t)(vcombine_u8((uint8x8_t)(__s0_775), (uint8x8_t)(vqrshrn_n_u16(__s1_775, __p2_775)))); \
60410 __ret_775; \
60411})
60100__ai int16x8_t vsubhn_high_s32(int16x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
60101 int16x8_t __ret;
60102 __ret = vcombine_s16(__p0, vsubhn_s32(__p1, __p2));
60103 return __ret;
60104}
6041260105#else
60413#define vqrshrn_high_n_u16(__p0_776, __p1_776, __p2_776) __extension__ ({ \
60414 uint8x16_t __ret_776; \
60415 uint8x8_t __s0_776 = __p0_776; \
60416 uint16x8_t __s1_776 = __p1_776; \
60417 uint8x8_t __rev0_776; __rev0_776 = __builtin_shufflevector(__s0_776, __s0_776, 7, 6, 5, 4, 3, 2, 1, 0); \
60418 uint16x8_t __rev1_776; __rev1_776 = __builtin_shufflevector(__s1_776, __s1_776, 7, 6, 5, 4, 3, 2, 1, 0); \
60419 __ret_776 = (uint8x16_t)(__noswap_vcombine_u8((uint8x8_t)(__rev0_776), (uint8x8_t)(__noswap_vqrshrn_n_u16(__rev1_776, __p2_776)))); \
60420 __ret_776 = __builtin_shufflevector(__ret_776, __ret_776, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
60421 __ret_776; \
60422})
60106__ai int16x8_t vsubhn_high_s32(int16x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
60107 int16x8_t __ret;
60108 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
60109 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
60110 int32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
60111 __ret = __noswap_vcombine_s16(__rev0, __noswap_vsubhn_s32(__rev1, __rev2));
60112 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
60113 return __ret;
60114}
6042360115#endif
6042460116
6042560117#ifdef __LITTLE_ENDIAN__
60426#define vqrshrn_high_n_s32(__p0_777, __p1_777, __p2_777) __extension__ ({ \
60427 int16x8_t __ret_777; \
60428 int16x4_t __s0_777 = __p0_777; \
60429 int32x4_t __s1_777 = __p1_777; \
60430 __ret_777 = (int16x8_t)(vcombine_s16((int16x4_t)(__s0_777), (int16x4_t)(vqrshrn_n_s32(__s1_777, __p2_777)))); \
60431 __ret_777; \
60432})
60118__ai int32x4_t vsubhn_high_s64(int32x2_t __p0, int64x2_t __p1, int64x2_t __p2) {
60119 int32x4_t __ret;
60120 __ret = vcombine_s32(__p0, vsubhn_s64(__p1, __p2));
60121 return __ret;
60122}
6043360123#else
60434#define vqrshrn_high_n_s32(__p0_778, __p1_778, __p2_778) __extension__ ({ \
60435 int16x8_t __ret_778; \
60436 int16x4_t __s0_778 = __p0_778; \
60437 int32x4_t __s1_778 = __p1_778; \
60438 int16x4_t __rev0_778; __rev0_778 = __builtin_shufflevector(__s0_778, __s0_778, 3, 2, 1, 0); \
60439 int32x4_t __rev1_778; __rev1_778 = __builtin_shufflevector(__s1_778, __s1_778, 3, 2, 1, 0); \
60440 __ret_778 = (int16x8_t)(__noswap_vcombine_s16((int16x4_t)(__rev0_778), (int16x4_t)(__noswap_vqrshrn_n_s32(__rev1_778, __p2_778)))); \
60441 __ret_778 = __builtin_shufflevector(__ret_778, __ret_778, 7, 6, 5, 4, 3, 2, 1, 0); \
60442 __ret_778; \
60443})
60124__ai int32x4_t vsubhn_high_s64(int32x2_t __p0, int64x2_t __p1, int64x2_t __p2) {
60125 int32x4_t __ret;
60126 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
60127 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
60128 int64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
60129 __ret = __noswap_vcombine_s32(__rev0, __noswap_vsubhn_s64(__rev1, __rev2));
60130 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
60131 return __ret;
60132}
6044460133#endif
6044560134
6044660135#ifdef __LITTLE_ENDIAN__
60447#define vqrshrn_high_n_s64(__p0_779, __p1_779, __p2_779) __extension__ ({ \
60448 int32x4_t __ret_779; \
60449 int32x2_t __s0_779 = __p0_779; \
60450 int64x2_t __s1_779 = __p1_779; \
60451 __ret_779 = (int32x4_t)(vcombine_s32((int32x2_t)(__s0_779), (int32x2_t)(vqrshrn_n_s64(__s1_779, __p2_779)))); \
60452 __ret_779; \
60453})
60136__ai int8x16_t vsubhn_high_s16(int8x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
60137 int8x16_t __ret;
60138 __ret = vcombine_s8(__p0, vsubhn_s16(__p1, __p2));
60139 return __ret;
60140}
6045460141#else
60455#define vqrshrn_high_n_s64(__p0_780, __p1_780, __p2_780) __extension__ ({ \
60456 int32x4_t __ret_780; \
60457 int32x2_t __s0_780 = __p0_780; \
60458 int64x2_t __s1_780 = __p1_780; \
60459 int32x2_t __rev0_780; __rev0_780 = __builtin_shufflevector(__s0_780, __s0_780, 1, 0); \
60460 int64x2_t __rev1_780; __rev1_780 = __builtin_shufflevector(__s1_780, __s1_780, 1, 0); \
60461 __ret_780 = (int32x4_t)(__noswap_vcombine_s32((int32x2_t)(__rev0_780), (int32x2_t)(__noswap_vqrshrn_n_s64(__rev1_780, __p2_780)))); \
60462 __ret_780 = __builtin_shufflevector(__ret_780, __ret_780, 3, 2, 1, 0); \
60463 __ret_780; \
60464})
60142__ai int8x16_t vsubhn_high_s16(int8x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
60143 int8x16_t __ret;
60144 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
60145 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
60146 int16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
60147 __ret = __noswap_vcombine_s8(__rev0, __noswap_vsubhn_s16(__rev1, __rev2));
60148 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60149 return __ret;
60150}
6046560151#endif
6046660152
6046760153#ifdef __LITTLE_ENDIAN__
60468#define vqrshrn_high_n_s16(__p0_781, __p1_781, __p2_781) __extension__ ({ \
60469 int8x16_t __ret_781; \
60470 int8x8_t __s0_781 = __p0_781; \
60471 int16x8_t __s1_781 = __p1_781; \
60472 __ret_781 = (int8x16_t)(vcombine_s8((int8x8_t)(__s0_781), (int8x8_t)(vqrshrn_n_s16(__s1_781, __p2_781)))); \
60473 __ret_781; \
60474})
60154__ai uint16x8_t vsubl_high_u8(uint8x16_t __p0, uint8x16_t __p1) {
60155 uint16x8_t __ret;
60156 __ret = vmovl_high_u8(__p0) - vmovl_high_u8(__p1);
60157 return __ret;
60158}
6047560159#else
60476#define vqrshrn_high_n_s16(__p0_782, __p1_782, __p2_782) __extension__ ({ \
60477 int8x16_t __ret_782; \
60478 int8x8_t __s0_782 = __p0_782; \
60479 int16x8_t __s1_782 = __p1_782; \
60480 int8x8_t __rev0_782; __rev0_782 = __builtin_shufflevector(__s0_782, __s0_782, 7, 6, 5, 4, 3, 2, 1, 0); \
60481 int16x8_t __rev1_782; __rev1_782 = __builtin_shufflevector(__s1_782, __s1_782, 7, 6, 5, 4, 3, 2, 1, 0); \
60482 __ret_782 = (int8x16_t)(__noswap_vcombine_s8((int8x8_t)(__rev0_782), (int8x8_t)(__noswap_vqrshrn_n_s16(__rev1_782, __p2_782)))); \
60483 __ret_782 = __builtin_shufflevector(__ret_782, __ret_782, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
60484 __ret_782; \
60485})
60486#endif
60487
60488#define vqrshrns_n_u32(__p0, __p1) __extension__ ({ \
60489 uint16_t __ret; \
60490 uint32_t __s0 = __p0; \
60491 __ret = (uint16_t) __builtin_neon_vqrshrns_n_u32(__s0, __p1); \
60492 __ret; \
60493})
60494#define vqrshrnd_n_u64(__p0, __p1) __extension__ ({ \
60495 uint32_t __ret; \
60496 uint64_t __s0 = __p0; \
60497 __ret = (uint32_t) __builtin_neon_vqrshrnd_n_u64(__s0, __p1); \
60498 __ret; \
60499})
60500#define vqrshrnh_n_u16(__p0, __p1) __extension__ ({ \
60501 uint8_t __ret; \
60502 uint16_t __s0 = __p0; \
60503 __ret = (uint8_t) __builtin_neon_vqrshrnh_n_u16(__s0, __p1); \
60504 __ret; \
60505})
60506#define vqrshrns_n_s32(__p0, __p1) __extension__ ({ \
60507 int16_t __ret; \
60508 int32_t __s0 = __p0; \
60509 __ret = (int16_t) __builtin_neon_vqrshrns_n_s32(__s0, __p1); \
60510 __ret; \
60511})
60512#define vqrshrnd_n_s64(__p0, __p1) __extension__ ({ \
60513 int32_t __ret; \
60514 int64_t __s0 = __p0; \
60515 __ret = (int32_t) __builtin_neon_vqrshrnd_n_s64(__s0, __p1); \
60516 __ret; \
60517})
60518#define vqrshrnh_n_s16(__p0, __p1) __extension__ ({ \
60519 int8_t __ret; \
60520 int16_t __s0 = __p0; \
60521 __ret = (int8_t) __builtin_neon_vqrshrnh_n_s16(__s0, __p1); \
60522 __ret; \
60523})
60160__ai uint16x8_t vsubl_high_u8(uint8x16_t __p0, uint8x16_t __p1) {
60161 uint16x8_t __ret;
60162 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60163 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60164 __ret = __noswap_vmovl_high_u8(__rev0) - __noswap_vmovl_high_u8(__rev1);
60165 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
60166 return __ret;
60167}
60168#endif
60169
6052460170#ifdef __LITTLE_ENDIAN__
60525#define vqrshrun_high_n_s32(__p0_783, __p1_783, __p2_783) __extension__ ({ \
60526 int16x8_t __ret_783; \
60527 int16x4_t __s0_783 = __p0_783; \
60528 int32x4_t __s1_783 = __p1_783; \
60529 __ret_783 = (int16x8_t)(vcombine_s16((int16x4_t)(__s0_783), (int16x4_t)(vqrshrun_n_s32(__s1_783, __p2_783)))); \
60530 __ret_783; \
60531})
60171__ai uint64x2_t vsubl_high_u32(uint32x4_t __p0, uint32x4_t __p1) {
60172 uint64x2_t __ret;
60173 __ret = vmovl_high_u32(__p0) - vmovl_high_u32(__p1);
60174 return __ret;
60175}
6053260176#else
60533#define vqrshrun_high_n_s32(__p0_784, __p1_784, __p2_784) __extension__ ({ \
60534 int16x8_t __ret_784; \
60535 int16x4_t __s0_784 = __p0_784; \
60536 int32x4_t __s1_784 = __p1_784; \
60537 int16x4_t __rev0_784; __rev0_784 = __builtin_shufflevector(__s0_784, __s0_784, 3, 2, 1, 0); \
60538 int32x4_t __rev1_784; __rev1_784 = __builtin_shufflevector(__s1_784, __s1_784, 3, 2, 1, 0); \
60539 __ret_784 = (int16x8_t)(__noswap_vcombine_s16((int16x4_t)(__rev0_784), (int16x4_t)(__noswap_vqrshrun_n_s32(__rev1_784, __p2_784)))); \
60540 __ret_784 = __builtin_shufflevector(__ret_784, __ret_784, 7, 6, 5, 4, 3, 2, 1, 0); \
60541 __ret_784; \
60542})
60177__ai uint64x2_t vsubl_high_u32(uint32x4_t __p0, uint32x4_t __p1) {
60178 uint64x2_t __ret;
60179 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
60180 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
60181 __ret = __noswap_vmovl_high_u32(__rev0) - __noswap_vmovl_high_u32(__rev1);
60182 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
60183 return __ret;
60184}
6054360185#endif
6054460186
6054560187#ifdef __LITTLE_ENDIAN__
60546#define vqrshrun_high_n_s64(__p0_785, __p1_785, __p2_785) __extension__ ({ \
60547 int32x4_t __ret_785; \
60548 int32x2_t __s0_785 = __p0_785; \
60549 int64x2_t __s1_785 = __p1_785; \
60550 __ret_785 = (int32x4_t)(vcombine_s32((int32x2_t)(__s0_785), (int32x2_t)(vqrshrun_n_s64(__s1_785, __p2_785)))); \
60551 __ret_785; \
60552})
60188__ai uint32x4_t vsubl_high_u16(uint16x8_t __p0, uint16x8_t __p1) {
60189 uint32x4_t __ret;
60190 __ret = vmovl_high_u16(__p0) - vmovl_high_u16(__p1);
60191 return __ret;
60192}
6055360193#else
60554#define vqrshrun_high_n_s64(__p0_786, __p1_786, __p2_786) __extension__ ({ \
60555 int32x4_t __ret_786; \
60556 int32x2_t __s0_786 = __p0_786; \
60557 int64x2_t __s1_786 = __p1_786; \
60558 int32x2_t __rev0_786; __rev0_786 = __builtin_shufflevector(__s0_786, __s0_786, 1, 0); \
60559 int64x2_t __rev1_786; __rev1_786 = __builtin_shufflevector(__s1_786, __s1_786, 1, 0); \
60560 __ret_786 = (int32x4_t)(__noswap_vcombine_s32((int32x2_t)(__rev0_786), (int32x2_t)(__noswap_vqrshrun_n_s64(__rev1_786, __p2_786)))); \
60561 __ret_786 = __builtin_shufflevector(__ret_786, __ret_786, 3, 2, 1, 0); \
60562 __ret_786; \
60563})
60194__ai uint32x4_t vsubl_high_u16(uint16x8_t __p0, uint16x8_t __p1) {
60195 uint32x4_t __ret;
60196 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
60197 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
60198 __ret = __noswap_vmovl_high_u16(__rev0) - __noswap_vmovl_high_u16(__rev1);
60199 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
60200 return __ret;
60201}
6056460202#endif
6056560203
6056660204#ifdef __LITTLE_ENDIAN__
60567#define vqrshrun_high_n_s16(__p0_787, __p1_787, __p2_787) __extension__ ({ \
60568 int8x16_t __ret_787; \
60569 int8x8_t __s0_787 = __p0_787; \
60570 int16x8_t __s1_787 = __p1_787; \
60571 __ret_787 = (int8x16_t)(vcombine_s8((int8x8_t)(__s0_787), (int8x8_t)(vqrshrun_n_s16(__s1_787, __p2_787)))); \
60572 __ret_787; \
60573})
60205__ai int16x8_t vsubl_high_s8(int8x16_t __p0, int8x16_t __p1) {
60206 int16x8_t __ret;
60207 __ret = vmovl_high_s8(__p0) - vmovl_high_s8(__p1);
60208 return __ret;
60209}
6057460210#else
60575#define vqrshrun_high_n_s16(__p0_788, __p1_788, __p2_788) __extension__ ({ \
60576 int8x16_t __ret_788; \
60577 int8x8_t __s0_788 = __p0_788; \
60578 int16x8_t __s1_788 = __p1_788; \
60579 int8x8_t __rev0_788; __rev0_788 = __builtin_shufflevector(__s0_788, __s0_788, 7, 6, 5, 4, 3, 2, 1, 0); \
60580 int16x8_t __rev1_788; __rev1_788 = __builtin_shufflevector(__s1_788, __s1_788, 7, 6, 5, 4, 3, 2, 1, 0); \
60581 __ret_788 = (int8x16_t)(__noswap_vcombine_s8((int8x8_t)(__rev0_788), (int8x8_t)(__noswap_vqrshrun_n_s16(__rev1_788, __p2_788)))); \
60582 __ret_788 = __builtin_shufflevector(__ret_788, __ret_788, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
60583 __ret_788; \
60584})
60211__ai int16x8_t vsubl_high_s8(int8x16_t __p0, int8x16_t __p1) {
60212 int16x8_t __ret;
60213 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60214 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60215 __ret = __noswap_vmovl_high_s8(__rev0) - __noswap_vmovl_high_s8(__rev1);
60216 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
60217 return __ret;
60218}
6058560219#endif
6058660220
60587#define vqrshruns_n_s32(__p0, __p1) __extension__ ({ \
60588 int16_t __ret; \
60589 int32_t __s0 = __p0; \
60590 __ret = (int16_t) __builtin_neon_vqrshruns_n_s32(__s0, __p1); \
60591 __ret; \
60592})
60593#define vqrshrund_n_s64(__p0, __p1) __extension__ ({ \
60594 int32_t __ret; \
60595 int64_t __s0 = __p0; \
60596 __ret = (int32_t) __builtin_neon_vqrshrund_n_s64(__s0, __p1); \
60597 __ret; \
60598})
60599#define vqrshrunh_n_s16(__p0, __p1) __extension__ ({ \
60600 int8_t __ret; \
60601 int16_t __s0 = __p0; \
60602 __ret = (int8_t) __builtin_neon_vqrshrunh_n_s16(__s0, __p1); \
60603 __ret; \
60604})
60605__ai uint8_t vqshlb_u8(uint8_t __p0, int8_t __p1) {
60606 uint8_t __ret;
60607 __ret = (uint8_t) __builtin_neon_vqshlb_u8(__p0, __p1);
60221#ifdef __LITTLE_ENDIAN__
60222__ai int64x2_t vsubl_high_s32(int32x4_t __p0, int32x4_t __p1) {
60223 int64x2_t __ret;
60224 __ret = vmovl_high_s32(__p0) - vmovl_high_s32(__p1);
6060860225 return __ret;
6060960226}
60610__ai uint32_t vqshls_u32(uint32_t __p0, int32_t __p1) {
60611 uint32_t __ret;
60612 __ret = (uint32_t) __builtin_neon_vqshls_u32(__p0, __p1);
60227#else
60228__ai int64x2_t vsubl_high_s32(int32x4_t __p0, int32x4_t __p1) {
60229 int64x2_t __ret;
60230 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
60231 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
60232 __ret = __noswap_vmovl_high_s32(__rev0) - __noswap_vmovl_high_s32(__rev1);
60233 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6061360234 return __ret;
6061460235}
60615__ai uint64_t vqshld_u64(uint64_t __p0, int64_t __p1) {
60616 uint64_t __ret;
60617 __ret = (uint64_t) __builtin_neon_vqshld_u64(__p0, __p1);
60236#endif
60237
60238#ifdef __LITTLE_ENDIAN__
60239__ai int32x4_t vsubl_high_s16(int16x8_t __p0, int16x8_t __p1) {
60240 int32x4_t __ret;
60241 __ret = vmovl_high_s16(__p0) - vmovl_high_s16(__p1);
6061860242 return __ret;
6061960243}
60620__ai uint16_t vqshlh_u16(uint16_t __p0, int16_t __p1) {
60621 uint16_t __ret;
60622 __ret = (uint16_t) __builtin_neon_vqshlh_u16(__p0, __p1);
60244#else
60245__ai int32x4_t vsubl_high_s16(int16x8_t __p0, int16x8_t __p1) {
60246 int32x4_t __ret;
60247 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
60248 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
60249 __ret = __noswap_vmovl_high_s16(__rev0) - __noswap_vmovl_high_s16(__rev1);
60250 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6062360251 return __ret;
6062460252}
60625__ai int8_t vqshlb_s8(int8_t __p0, int8_t __p1) {
60626 int8_t __ret;
60627 __ret = (int8_t) __builtin_neon_vqshlb_s8(__p0, __p1);
60253#endif
60254
60255#ifdef __LITTLE_ENDIAN__
60256__ai uint16x8_t vsubw_high_u8(uint16x8_t __p0, uint8x16_t __p1) {
60257 uint16x8_t __ret;
60258 __ret = __p0 - vmovl_high_u8(__p1);
6062860259 return __ret;
6062960260}
60630__ai int32_t vqshls_s32(int32_t __p0, int32_t __p1) {
60631 int32_t __ret;
60632 __ret = (int32_t) __builtin_neon_vqshls_s32(__p0, __p1);
60261#else
60262__ai uint16x8_t vsubw_high_u8(uint16x8_t __p0, uint8x16_t __p1) {
60263 uint16x8_t __ret;
60264 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
60265 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60266 __ret = __rev0 - __noswap_vmovl_high_u8(__rev1);
60267 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6063360268 return __ret;
6063460269}
60635__ai int64_t vqshld_s64(int64_t __p0, int64_t __p1) {
60636 int64_t __ret;
60637 __ret = (int64_t) __builtin_neon_vqshld_s64(__p0, __p1);
60270#endif
60271
60272#ifdef __LITTLE_ENDIAN__
60273__ai uint64x2_t vsubw_high_u32(uint64x2_t __p0, uint32x4_t __p1) {
60274 uint64x2_t __ret;
60275 __ret = __p0 - vmovl_high_u32(__p1);
6063860276 return __ret;
6063960277}
60640__ai int16_t vqshlh_s16(int16_t __p0, int16_t __p1) {
60641 int16_t __ret;
60642 __ret = (int16_t) __builtin_neon_vqshlh_s16(__p0, __p1);
60278#else
60279__ai uint64x2_t vsubw_high_u32(uint64x2_t __p0, uint32x4_t __p1) {
60280 uint64x2_t __ret;
60281 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
60282 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
60283 __ret = __rev0 - __noswap_vmovl_high_u32(__rev1);
60284 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6064360285 return __ret;
6064460286}
60645#define vqshlb_n_u8(__p0, __p1) __extension__ ({ \
60646 uint8_t __ret; \
60647 uint8_t __s0 = __p0; \
60648 __ret = (uint8_t) __builtin_neon_vqshlb_n_u8(__s0, __p1); \
60649 __ret; \
60650})
60651#define vqshls_n_u32(__p0, __p1) __extension__ ({ \
60652 uint32_t __ret; \
60653 uint32_t __s0 = __p0; \
60654 __ret = (uint32_t) __builtin_neon_vqshls_n_u32(__s0, __p1); \
60655 __ret; \
60656})
60657#define vqshld_n_u64(__p0, __p1) __extension__ ({ \
60658 uint64_t __ret; \
60659 uint64_t __s0 = __p0; \
60660 __ret = (uint64_t) __builtin_neon_vqshld_n_u64(__s0, __p1); \
60661 __ret; \
60662})
60663#define vqshlh_n_u16(__p0, __p1) __extension__ ({ \
60664 uint16_t __ret; \
60665 uint16_t __s0 = __p0; \
60666 __ret = (uint16_t) __builtin_neon_vqshlh_n_u16(__s0, __p1); \
60667 __ret; \
60668})
60669#define vqshlb_n_s8(__p0, __p1) __extension__ ({ \
60670 int8_t __ret; \
60671 int8_t __s0 = __p0; \
60672 __ret = (int8_t) __builtin_neon_vqshlb_n_s8(__s0, __p1); \
60673 __ret; \
60674})
60675#define vqshls_n_s32(__p0, __p1) __extension__ ({ \
60676 int32_t __ret; \
60677 int32_t __s0 = __p0; \
60678 __ret = (int32_t) __builtin_neon_vqshls_n_s32(__s0, __p1); \
60679 __ret; \
60680})
60681#define vqshld_n_s64(__p0, __p1) __extension__ ({ \
60682 int64_t __ret; \
60683 int64_t __s0 = __p0; \
60684 __ret = (int64_t) __builtin_neon_vqshld_n_s64(__s0, __p1); \
60685 __ret; \
60686})
60687#define vqshlh_n_s16(__p0, __p1) __extension__ ({ \
60688 int16_t __ret; \
60689 int16_t __s0 = __p0; \
60690 __ret = (int16_t) __builtin_neon_vqshlh_n_s16(__s0, __p1); \
60691 __ret; \
60692})
60693#define vqshlub_n_s8(__p0, __p1) __extension__ ({ \
60694 int8_t __ret; \
60695 int8_t __s0 = __p0; \
60696 __ret = (int8_t) __builtin_neon_vqshlub_n_s8(__s0, __p1); \
60697 __ret; \
60698})
60699#define vqshlus_n_s32(__p0, __p1) __extension__ ({ \
60700 int32_t __ret; \
60701 int32_t __s0 = __p0; \
60702 __ret = (int32_t) __builtin_neon_vqshlus_n_s32(__s0, __p1); \
60703 __ret; \
60704})
60705#define vqshlud_n_s64(__p0, __p1) __extension__ ({ \
60706 int64_t __ret; \
60707 int64_t __s0 = __p0; \
60708 __ret = (int64_t) __builtin_neon_vqshlud_n_s64(__s0, __p1); \
60709 __ret; \
60710})
60711#define vqshluh_n_s16(__p0, __p1) __extension__ ({ \
60712 int16_t __ret; \
60713 int16_t __s0 = __p0; \
60714 __ret = (int16_t) __builtin_neon_vqshluh_n_s16(__s0, __p1); \
60715 __ret; \
60716})
60287#endif
60288
6071760289#ifdef __LITTLE_ENDIAN__
60718#define vqshrn_high_n_u32(__p0_789, __p1_789, __p2_789) __extension__ ({ \
60719 uint16x8_t __ret_789; \
60720 uint16x4_t __s0_789 = __p0_789; \
60721 uint32x4_t __s1_789 = __p1_789; \
60722 __ret_789 = (uint16x8_t)(vcombine_u16((uint16x4_t)(__s0_789), (uint16x4_t)(vqshrn_n_u32(__s1_789, __p2_789)))); \
60723 __ret_789; \
60724})
60290__ai uint32x4_t vsubw_high_u16(uint32x4_t __p0, uint16x8_t __p1) {
60291 uint32x4_t __ret;
60292 __ret = __p0 - vmovl_high_u16(__p1);
60293 return __ret;
60294}
6072560295#else
60726#define vqshrn_high_n_u32(__p0_790, __p1_790, __p2_790) __extension__ ({ \
60727 uint16x8_t __ret_790; \
60728 uint16x4_t __s0_790 = __p0_790; \
60729 uint32x4_t __s1_790 = __p1_790; \
60730 uint16x4_t __rev0_790; __rev0_790 = __builtin_shufflevector(__s0_790, __s0_790, 3, 2, 1, 0); \
60731 uint32x4_t __rev1_790; __rev1_790 = __builtin_shufflevector(__s1_790, __s1_790, 3, 2, 1, 0); \
60732 __ret_790 = (uint16x8_t)(__noswap_vcombine_u16((uint16x4_t)(__rev0_790), (uint16x4_t)(__noswap_vqshrn_n_u32(__rev1_790, __p2_790)))); \
60733 __ret_790 = __builtin_shufflevector(__ret_790, __ret_790, 7, 6, 5, 4, 3, 2, 1, 0); \
60734 __ret_790; \
60735})
60296__ai uint32x4_t vsubw_high_u16(uint32x4_t __p0, uint16x8_t __p1) {
60297 uint32x4_t __ret;
60298 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
60299 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
60300 __ret = __rev0 - __noswap_vmovl_high_u16(__rev1);
60301 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
60302 return __ret;
60303}
6073660304#endif
6073760305
6073860306#ifdef __LITTLE_ENDIAN__
60739#define vqshrn_high_n_u64(__p0_791, __p1_791, __p2_791) __extension__ ({ \
60740 uint32x4_t __ret_791; \
60741 uint32x2_t __s0_791 = __p0_791; \
60742 uint64x2_t __s1_791 = __p1_791; \
60743 __ret_791 = (uint32x4_t)(vcombine_u32((uint32x2_t)(__s0_791), (uint32x2_t)(vqshrn_n_u64(__s1_791, __p2_791)))); \
60744 __ret_791; \
60745})
60307__ai int16x8_t vsubw_high_s8(int16x8_t __p0, int8x16_t __p1) {
60308 int16x8_t __ret;
60309 __ret = __p0 - vmovl_high_s8(__p1);
60310 return __ret;
60311}
6074660312#else
60747#define vqshrn_high_n_u64(__p0_792, __p1_792, __p2_792) __extension__ ({ \
60748 uint32x4_t __ret_792; \
60749 uint32x2_t __s0_792 = __p0_792; \
60750 uint64x2_t __s1_792 = __p1_792; \
60751 uint32x2_t __rev0_792; __rev0_792 = __builtin_shufflevector(__s0_792, __s0_792, 1, 0); \
60752 uint64x2_t __rev1_792; __rev1_792 = __builtin_shufflevector(__s1_792, __s1_792, 1, 0); \
60753 __ret_792 = (uint32x4_t)(__noswap_vcombine_u32((uint32x2_t)(__rev0_792), (uint32x2_t)(__noswap_vqshrn_n_u64(__rev1_792, __p2_792)))); \
60754 __ret_792 = __builtin_shufflevector(__ret_792, __ret_792, 3, 2, 1, 0); \
60755 __ret_792; \
60756})
60313__ai int16x8_t vsubw_high_s8(int16x8_t __p0, int8x16_t __p1) {
60314 int16x8_t __ret;
60315 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
60316 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60317 __ret = __rev0 - __noswap_vmovl_high_s8(__rev1);
60318 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
60319 return __ret;
60320}
6075760321#endif
6075860322
6075960323#ifdef __LITTLE_ENDIAN__
60760#define vqshrn_high_n_u16(__p0_793, __p1_793, __p2_793) __extension__ ({ \
60761 uint8x16_t __ret_793; \
60762 uint8x8_t __s0_793 = __p0_793; \
60763 uint16x8_t __s1_793 = __p1_793; \
60764 __ret_793 = (uint8x16_t)(vcombine_u8((uint8x8_t)(__s0_793), (uint8x8_t)(vqshrn_n_u16(__s1_793, __p2_793)))); \
60765 __ret_793; \
60766})
60324__ai int64x2_t vsubw_high_s32(int64x2_t __p0, int32x4_t __p1) {
60325 int64x2_t __ret;
60326 __ret = __p0 - vmovl_high_s32(__p1);
60327 return __ret;
60328}
6076760329#else
60768#define vqshrn_high_n_u16(__p0_794, __p1_794, __p2_794) __extension__ ({ \
60769 uint8x16_t __ret_794; \
60770 uint8x8_t __s0_794 = __p0_794; \
60771 uint16x8_t __s1_794 = __p1_794; \
60772 uint8x8_t __rev0_794; __rev0_794 = __builtin_shufflevector(__s0_794, __s0_794, 7, 6, 5, 4, 3, 2, 1, 0); \
60773 uint16x8_t __rev1_794; __rev1_794 = __builtin_shufflevector(__s1_794, __s1_794, 7, 6, 5, 4, 3, 2, 1, 0); \
60774 __ret_794 = (uint8x16_t)(__noswap_vcombine_u8((uint8x8_t)(__rev0_794), (uint8x8_t)(__noswap_vqshrn_n_u16(__rev1_794, __p2_794)))); \
60775 __ret_794 = __builtin_shufflevector(__ret_794, __ret_794, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
60776 __ret_794; \
60777})
60330__ai int64x2_t vsubw_high_s32(int64x2_t __p0, int32x4_t __p1) {
60331 int64x2_t __ret;
60332 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
60333 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
60334 __ret = __rev0 - __noswap_vmovl_high_s32(__rev1);
60335 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
60336 return __ret;
60337}
6077860338#endif
6077960339
6078060340#ifdef __LITTLE_ENDIAN__
60781#define vqshrn_high_n_s32(__p0_795, __p1_795, __p2_795) __extension__ ({ \
60782 int16x8_t __ret_795; \
60783 int16x4_t __s0_795 = __p0_795; \
60784 int32x4_t __s1_795 = __p1_795; \
60785 __ret_795 = (int16x8_t)(vcombine_s16((int16x4_t)(__s0_795), (int16x4_t)(vqshrn_n_s32(__s1_795, __p2_795)))); \
60786 __ret_795; \
60787})
60341__ai int32x4_t vsubw_high_s16(int32x4_t __p0, int16x8_t __p1) {
60342 int32x4_t __ret;
60343 __ret = __p0 - vmovl_high_s16(__p1);
60344 return __ret;
60345}
6078860346#else
60789#define vqshrn_high_n_s32(__p0_796, __p1_796, __p2_796) __extension__ ({ \
60790 int16x8_t __ret_796; \
60791 int16x4_t __s0_796 = __p0_796; \
60792 int32x4_t __s1_796 = __p1_796; \
60793 int16x4_t __rev0_796; __rev0_796 = __builtin_shufflevector(__s0_796, __s0_796, 3, 2, 1, 0); \
60794 int32x4_t __rev1_796; __rev1_796 = __builtin_shufflevector(__s1_796, __s1_796, 3, 2, 1, 0); \
60795 __ret_796 = (int16x8_t)(__noswap_vcombine_s16((int16x4_t)(__rev0_796), (int16x4_t)(__noswap_vqshrn_n_s32(__rev1_796, __p2_796)))); \
60796 __ret_796 = __builtin_shufflevector(__ret_796, __ret_796, 7, 6, 5, 4, 3, 2, 1, 0); \
60797 __ret_796; \
60798})
60347__ai int32x4_t vsubw_high_s16(int32x4_t __p0, int16x8_t __p1) {
60348 int32x4_t __ret;
60349 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
60350 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
60351 __ret = __rev0 - __noswap_vmovl_high_s16(__rev1);
60352 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
60353 return __ret;
60354}
6079960355#endif
6080060356
6080160357#ifdef __LITTLE_ENDIAN__
60802#define vqshrn_high_n_s64(__p0_797, __p1_797, __p2_797) __extension__ ({ \
60803 int32x4_t __ret_797; \
60804 int32x2_t __s0_797 = __p0_797; \
60805 int64x2_t __s1_797 = __p1_797; \
60806 __ret_797 = (int32x4_t)(vcombine_s32((int32x2_t)(__s0_797), (int32x2_t)(vqshrn_n_s64(__s1_797, __p2_797)))); \
60807 __ret_797; \
60808})
60358__ai poly8x8_t vtrn1_p8(poly8x8_t __p0, poly8x8_t __p1) {
60359 poly8x8_t __ret;
60360 __ret = __builtin_shufflevector(__p0, __p1, 0, 8, 2, 10, 4, 12, 6, 14);
60361 return __ret;
60362}
6080960363#else
60810#define vqshrn_high_n_s64(__p0_798, __p1_798, __p2_798) __extension__ ({ \
60811 int32x4_t __ret_798; \
60812 int32x2_t __s0_798 = __p0_798; \
60813 int64x2_t __s1_798 = __p1_798; \
60814 int32x2_t __rev0_798; __rev0_798 = __builtin_shufflevector(__s0_798, __s0_798, 1, 0); \
60815 int64x2_t __rev1_798; __rev1_798 = __builtin_shufflevector(__s1_798, __s1_798, 1, 0); \
60816 __ret_798 = (int32x4_t)(__noswap_vcombine_s32((int32x2_t)(__rev0_798), (int32x2_t)(__noswap_vqshrn_n_s64(__rev1_798, __p2_798)))); \
60817 __ret_798 = __builtin_shufflevector(__ret_798, __ret_798, 3, 2, 1, 0); \
60818 __ret_798; \
60819})
60364__ai poly8x8_t vtrn1_p8(poly8x8_t __p0, poly8x8_t __p1) {
60365 poly8x8_t __ret;
60366 poly8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
60367 poly8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
60368 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 8, 2, 10, 4, 12, 6, 14);
60369 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
60370 return __ret;
60371}
6082060372#endif
6082160373
6082260374#ifdef __LITTLE_ENDIAN__
60823#define vqshrn_high_n_s16(__p0_799, __p1_799, __p2_799) __extension__ ({ \
60824 int8x16_t __ret_799; \
60825 int8x8_t __s0_799 = __p0_799; \
60826 int16x8_t __s1_799 = __p1_799; \
60827 __ret_799 = (int8x16_t)(vcombine_s8((int8x8_t)(__s0_799), (int8x8_t)(vqshrn_n_s16(__s1_799, __p2_799)))); \
60828 __ret_799; \
60829})
60375__ai poly16x4_t vtrn1_p16(poly16x4_t __p0, poly16x4_t __p1) {
60376 poly16x4_t __ret;
60377 __ret = __builtin_shufflevector(__p0, __p1, 0, 4, 2, 6);
60378 return __ret;
60379}
6083060380#else
60831#define vqshrn_high_n_s16(__p0_800, __p1_800, __p2_800) __extension__ ({ \
60832 int8x16_t __ret_800; \
60833 int8x8_t __s0_800 = __p0_800; \
60834 int16x8_t __s1_800 = __p1_800; \
60835 int8x8_t __rev0_800; __rev0_800 = __builtin_shufflevector(__s0_800, __s0_800, 7, 6, 5, 4, 3, 2, 1, 0); \
60836 int16x8_t __rev1_800; __rev1_800 = __builtin_shufflevector(__s1_800, __s1_800, 7, 6, 5, 4, 3, 2, 1, 0); \
60837 __ret_800 = (int8x16_t)(__noswap_vcombine_s8((int8x8_t)(__rev0_800), (int8x8_t)(__noswap_vqshrn_n_s16(__rev1_800, __p2_800)))); \
60838 __ret_800 = __builtin_shufflevector(__ret_800, __ret_800, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
60839 __ret_800; \
60840})
60381__ai poly16x4_t vtrn1_p16(poly16x4_t __p0, poly16x4_t __p1) {
60382 poly16x4_t __ret;
60383 poly16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
60384 poly16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
60385 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 4, 2, 6);
60386 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
60387 return __ret;
60388}
6084160389#endif
6084260390
60843#define vqshrns_n_u32(__p0, __p1) __extension__ ({ \
60844 uint16_t __ret; \
60845 uint32_t __s0 = __p0; \
60846 __ret = (uint16_t) __builtin_neon_vqshrns_n_u32(__s0, __p1); \
60847 __ret; \
60848})
60849#define vqshrnd_n_u64(__p0, __p1) __extension__ ({ \
60850 uint32_t __ret; \
60851 uint64_t __s0 = __p0; \
60852 __ret = (uint32_t) __builtin_neon_vqshrnd_n_u64(__s0, __p1); \
60853 __ret; \
60854})
60855#define vqshrnh_n_u16(__p0, __p1) __extension__ ({ \
60856 uint8_t __ret; \
60857 uint16_t __s0 = __p0; \
60858 __ret = (uint8_t) __builtin_neon_vqshrnh_n_u16(__s0, __p1); \
60859 __ret; \
60860})
60861#define vqshrns_n_s32(__p0, __p1) __extension__ ({ \
60862 int16_t __ret; \
60863 int32_t __s0 = __p0; \
60864 __ret = (int16_t) __builtin_neon_vqshrns_n_s32(__s0, __p1); \
60865 __ret; \
60866})
60867#define vqshrnd_n_s64(__p0, __p1) __extension__ ({ \
60868 int32_t __ret; \
60869 int64_t __s0 = __p0; \
60870 __ret = (int32_t) __builtin_neon_vqshrnd_n_s64(__s0, __p1); \
60871 __ret; \
60872})
60873#define vqshrnh_n_s16(__p0, __p1) __extension__ ({ \
60874 int8_t __ret; \
60875 int16_t __s0 = __p0; \
60876 __ret = (int8_t) __builtin_neon_vqshrnh_n_s16(__s0, __p1); \
60877 __ret; \
60878})
6087960391#ifdef __LITTLE_ENDIAN__
60880#define vqshrun_high_n_s32(__p0_801, __p1_801, __p2_801) __extension__ ({ \
60881 int16x8_t __ret_801; \
60882 int16x4_t __s0_801 = __p0_801; \
60883 int32x4_t __s1_801 = __p1_801; \
60884 __ret_801 = (int16x8_t)(vcombine_s16((int16x4_t)(__s0_801), (int16x4_t)(vqshrun_n_s32(__s1_801, __p2_801)))); \
60885 __ret_801; \
60886})
60392__ai poly8x16_t vtrn1q_p8(poly8x16_t __p0, poly8x16_t __p1) {
60393 poly8x16_t __ret;
60394 __ret = __builtin_shufflevector(__p0, __p1, 0, 16, 2, 18, 4, 20, 6, 22, 8, 24, 10, 26, 12, 28, 14, 30);
60395 return __ret;
60396}
6088760397#else
60888#define vqshrun_high_n_s32(__p0_802, __p1_802, __p2_802) __extension__ ({ \
60889 int16x8_t __ret_802; \
60890 int16x4_t __s0_802 = __p0_802; \
60891 int32x4_t __s1_802 = __p1_802; \
60892 int16x4_t __rev0_802; __rev0_802 = __builtin_shufflevector(__s0_802, __s0_802, 3, 2, 1, 0); \
60893 int32x4_t __rev1_802; __rev1_802 = __builtin_shufflevector(__s1_802, __s1_802, 3, 2, 1, 0); \
60894 __ret_802 = (int16x8_t)(__noswap_vcombine_s16((int16x4_t)(__rev0_802), (int16x4_t)(__noswap_vqshrun_n_s32(__rev1_802, __p2_802)))); \
60895 __ret_802 = __builtin_shufflevector(__ret_802, __ret_802, 7, 6, 5, 4, 3, 2, 1, 0); \
60896 __ret_802; \
60897})
60398__ai poly8x16_t vtrn1q_p8(poly8x16_t __p0, poly8x16_t __p1) {
60399 poly8x16_t __ret;
60400 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60401 poly8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60402 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 16, 2, 18, 4, 20, 6, 22, 8, 24, 10, 26, 12, 28, 14, 30);
60403 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60404 return __ret;
60405}
6089860406#endif
6089960407
6090060408#ifdef __LITTLE_ENDIAN__
60901#define vqshrun_high_n_s64(__p0_803, __p1_803, __p2_803) __extension__ ({ \
60902 int32x4_t __ret_803; \
60903 int32x2_t __s0_803 = __p0_803; \
60904 int64x2_t __s1_803 = __p1_803; \
60905 __ret_803 = (int32x4_t)(vcombine_s32((int32x2_t)(__s0_803), (int32x2_t)(vqshrun_n_s64(__s1_803, __p2_803)))); \
60906 __ret_803; \
60907})
60409__ai poly64x2_t vtrn1q_p64(poly64x2_t __p0, poly64x2_t __p1) {
60410 poly64x2_t __ret;
60411 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
60412 return __ret;
60413}
6090860414#else
60909#define vqshrun_high_n_s64(__p0_804, __p1_804, __p2_804) __extension__ ({ \
60910 int32x4_t __ret_804; \
60911 int32x2_t __s0_804 = __p0_804; \
60912 int64x2_t __s1_804 = __p1_804; \
60913 int32x2_t __rev0_804; __rev0_804 = __builtin_shufflevector(__s0_804, __s0_804, 1, 0); \
60914 int64x2_t __rev1_804; __rev1_804 = __builtin_shufflevector(__s1_804, __s1_804, 1, 0); \
60915 __ret_804 = (int32x4_t)(__noswap_vcombine_s32((int32x2_t)(__rev0_804), (int32x2_t)(__noswap_vqshrun_n_s64(__rev1_804, __p2_804)))); \
60916 __ret_804 = __builtin_shufflevector(__ret_804, __ret_804, 3, 2, 1, 0); \
60917 __ret_804; \
60918})
60415__ai poly64x2_t vtrn1q_p64(poly64x2_t __p0, poly64x2_t __p1) {
60416 poly64x2_t __ret;
60417 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
60418 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
60419 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
60420 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
60421 return __ret;
60422}
6091960423#endif
6092060424
6092160425#ifdef __LITTLE_ENDIAN__
60922#define vqshrun_high_n_s16(__p0_805, __p1_805, __p2_805) __extension__ ({ \
60923 int8x16_t __ret_805; \
60924 int8x8_t __s0_805 = __p0_805; \
60925 int16x8_t __s1_805 = __p1_805; \
60926 __ret_805 = (int8x16_t)(vcombine_s8((int8x8_t)(__s0_805), (int8x8_t)(vqshrun_n_s16(__s1_805, __p2_805)))); \
60927 __ret_805; \
60928})
60426__ai poly16x8_t vtrn1q_p16(poly16x8_t __p0, poly16x8_t __p1) {
60427 poly16x8_t __ret;
60428 __ret = __builtin_shufflevector(__p0, __p1, 0, 8, 2, 10, 4, 12, 6, 14);
60429 return __ret;
60430}
6092960431#else
60930#define vqshrun_high_n_s16(__p0_806, __p1_806, __p2_806) __extension__ ({ \
60931 int8x16_t __ret_806; \
60932 int8x8_t __s0_806 = __p0_806; \
60933 int16x8_t __s1_806 = __p1_806; \
60934 int8x8_t __rev0_806; __rev0_806 = __builtin_shufflevector(__s0_806, __s0_806, 7, 6, 5, 4, 3, 2, 1, 0); \
60935 int16x8_t __rev1_806; __rev1_806 = __builtin_shufflevector(__s1_806, __s1_806, 7, 6, 5, 4, 3, 2, 1, 0); \
60936 __ret_806 = (int8x16_t)(__noswap_vcombine_s8((int8x8_t)(__rev0_806), (int8x8_t)(__noswap_vqshrun_n_s16(__rev1_806, __p2_806)))); \
60937 __ret_806 = __builtin_shufflevector(__ret_806, __ret_806, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
60938 __ret_806; \
60939})
60432__ai poly16x8_t vtrn1q_p16(poly16x8_t __p0, poly16x8_t __p1) {
60433 poly16x8_t __ret;
60434 poly16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
60435 poly16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
60436 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 8, 2, 10, 4, 12, 6, 14);
60437 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
60438 return __ret;
60439}
6094060440#endif
6094160441
60942#define vqshruns_n_s32(__p0, __p1) __extension__ ({ \
60943 int16_t __ret; \
60944 int32_t __s0 = __p0; \
60945 __ret = (int16_t) __builtin_neon_vqshruns_n_s32(__s0, __p1); \
60946 __ret; \
60947})
60948#define vqshrund_n_s64(__p0, __p1) __extension__ ({ \
60949 int32_t __ret; \
60950 int64_t __s0 = __p0; \
60951 __ret = (int32_t) __builtin_neon_vqshrund_n_s64(__s0, __p1); \
60952 __ret; \
60953})
60954#define vqshrunh_n_s16(__p0, __p1) __extension__ ({ \
60955 int8_t __ret; \
60956 int16_t __s0 = __p0; \
60957 __ret = (int8_t) __builtin_neon_vqshrunh_n_s16(__s0, __p1); \
60958 __ret; \
60959})
60960__ai uint8_t vqsubb_u8(uint8_t __p0, uint8_t __p1) {
60961 uint8_t __ret;
60962 __ret = (uint8_t) __builtin_neon_vqsubb_u8(__p0, __p1);
60442#ifdef __LITTLE_ENDIAN__
60443__ai uint8x16_t vtrn1q_u8(uint8x16_t __p0, uint8x16_t __p1) {
60444 uint8x16_t __ret;
60445 __ret = __builtin_shufflevector(__p0, __p1, 0, 16, 2, 18, 4, 20, 6, 22, 8, 24, 10, 26, 12, 28, 14, 30);
6096360446 return __ret;
6096460447}
60965__ai uint32_t vqsubs_u32(uint32_t __p0, uint32_t __p1) {
60966 uint32_t __ret;
60967 __ret = (uint32_t) __builtin_neon_vqsubs_u32(__p0, __p1);
60448#else
60449__ai uint8x16_t vtrn1q_u8(uint8x16_t __p0, uint8x16_t __p1) {
60450 uint8x16_t __ret;
60451 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60452 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60453 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 16, 2, 18, 4, 20, 6, 22, 8, 24, 10, 26, 12, 28, 14, 30);
60454 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
6096860455 return __ret;
6096960456}
60970__ai uint64_t vqsubd_u64(uint64_t __p0, uint64_t __p1) {
60971 uint64_t __ret;
60972 __ret = (uint64_t) __builtin_neon_vqsubd_u64(__p0, __p1);
60457#endif
60458
60459#ifdef __LITTLE_ENDIAN__
60460__ai uint32x4_t vtrn1q_u32(uint32x4_t __p0, uint32x4_t __p1) {
60461 uint32x4_t __ret;
60462 __ret = __builtin_shufflevector(__p0, __p1, 0, 4, 2, 6);
6097360463 return __ret;
6097460464}
60975__ai uint16_t vqsubh_u16(uint16_t __p0, uint16_t __p1) {
60976 uint16_t __ret;
60977 __ret = (uint16_t) __builtin_neon_vqsubh_u16(__p0, __p1);
60465#else
60466__ai uint32x4_t vtrn1q_u32(uint32x4_t __p0, uint32x4_t __p1) {
60467 uint32x4_t __ret;
60468 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
60469 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
60470 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 4, 2, 6);
60471 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6097860472 return __ret;
6097960473}
60980__ai int8_t vqsubb_s8(int8_t __p0, int8_t __p1) {
60981 int8_t __ret;
60982 __ret = (int8_t) __builtin_neon_vqsubb_s8(__p0, __p1);
60474#endif
60475
60476#ifdef __LITTLE_ENDIAN__
60477__ai uint64x2_t vtrn1q_u64(uint64x2_t __p0, uint64x2_t __p1) {
60478 uint64x2_t __ret;
60479 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
6098360480 return __ret;
6098460481}
60985__ai int32_t vqsubs_s32(int32_t __p0, int32_t __p1) {
60986 int32_t __ret;
60987 __ret = (int32_t) __builtin_neon_vqsubs_s32(__p0, __p1);
60482#else
60483__ai uint64x2_t vtrn1q_u64(uint64x2_t __p0, uint64x2_t __p1) {
60484 uint64x2_t __ret;
60485 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
60486 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
60487 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
60488 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
60489 return __ret;
60490}
60491#endif
60492
60493#ifdef __LITTLE_ENDIAN__
60494__ai uint16x8_t vtrn1q_u16(uint16x8_t __p0, uint16x8_t __p1) {
60495 uint16x8_t __ret;
60496 __ret = __builtin_shufflevector(__p0, __p1, 0, 8, 2, 10, 4, 12, 6, 14);
60497 return __ret;
60498}
60499#else
60500__ai uint16x8_t vtrn1q_u16(uint16x8_t __p0, uint16x8_t __p1) {
60501 uint16x8_t __ret;
60502 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
60503 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
60504 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 8, 2, 10, 4, 12, 6, 14);
60505 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6098860506 return __ret;
6098960507}
60990__ai int64_t vqsubd_s64(int64_t __p0, int64_t __p1) {
60991 int64_t __ret;
60992 __ret = (int64_t) __builtin_neon_vqsubd_s64(__p0, __p1);
60508#endif
60509
60510#ifdef __LITTLE_ENDIAN__
60511__ai int8x16_t vtrn1q_s8(int8x16_t __p0, int8x16_t __p1) {
60512 int8x16_t __ret;
60513 __ret = __builtin_shufflevector(__p0, __p1, 0, 16, 2, 18, 4, 20, 6, 22, 8, 24, 10, 26, 12, 28, 14, 30);
6099360514 return __ret;
6099460515}
60995__ai int16_t vqsubh_s16(int16_t __p0, int16_t __p1) {
60996 int16_t __ret;
60997 __ret = (int16_t) __builtin_neon_vqsubh_s16(__p0, __p1);
60516#else
60517__ai int8x16_t vtrn1q_s8(int8x16_t __p0, int8x16_t __p1) {
60518 int8x16_t __ret;
60519 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60520 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60521 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 16, 2, 18, 4, 20, 6, 22, 8, 24, 10, 26, 12, 28, 14, 30);
60522 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
6099860523 return __ret;
6099960524}
60525#endif
60526
6100060527#ifdef __LITTLE_ENDIAN__
61001__ai poly8x8_t vqtbl1_p8(poly8x16_t __p0, uint8x8_t __p1) {
61002 poly8x8_t __ret;
61003 __ret = (poly8x8_t) __builtin_neon_vqtbl1_v((int8x16_t)__p0, (int8x8_t)__p1, 4);
60528__ai float64x2_t vtrn1q_f64(float64x2_t __p0, float64x2_t __p1) {
60529 float64x2_t __ret;
60530 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
6100460531 return __ret;
6100560532}
6100660533#else
61007__ai poly8x8_t vqtbl1_p8(poly8x16_t __p0, uint8x8_t __p1) {
61008 poly8x8_t __ret;
61009 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61010 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
61011 __ret = (poly8x8_t) __builtin_neon_vqtbl1_v((int8x16_t)__rev0, (int8x8_t)__rev1, 4);
61012 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
60534__ai float64x2_t vtrn1q_f64(float64x2_t __p0, float64x2_t __p1) {
60535 float64x2_t __ret;
60536 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
60537 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
60538 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
60539 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6101360540 return __ret;
6101460541}
6101560542#endif
6101660543
6101760544#ifdef __LITTLE_ENDIAN__
61018__ai poly8x16_t vqtbl1q_p8(poly8x16_t __p0, uint8x16_t __p1) {
61019 poly8x16_t __ret;
61020 __ret = (poly8x16_t) __builtin_neon_vqtbl1q_v((int8x16_t)__p0, (int8x16_t)__p1, 36);
60545__ai float32x4_t vtrn1q_f32(float32x4_t __p0, float32x4_t __p1) {
60546 float32x4_t __ret;
60547 __ret = __builtin_shufflevector(__p0, __p1, 0, 4, 2, 6);
6102160548 return __ret;
6102260549}
6102360550#else
61024__ai poly8x16_t vqtbl1q_p8(poly8x16_t __p0, uint8x16_t __p1) {
61025 poly8x16_t __ret;
61026 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61027 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61028 __ret = (poly8x16_t) __builtin_neon_vqtbl1q_v((int8x16_t)__rev0, (int8x16_t)__rev1, 36);
61029 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60551__ai float32x4_t vtrn1q_f32(float32x4_t __p0, float32x4_t __p1) {
60552 float32x4_t __ret;
60553 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
60554 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
60555 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 4, 2, 6);
60556 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6103060557 return __ret;
6103160558}
6103260559#endif
6103360560
6103460561#ifdef __LITTLE_ENDIAN__
61035__ai uint8x16_t vqtbl1q_u8(uint8x16_t __p0, uint8x16_t __p1) {
61036 uint8x16_t __ret;
61037 __ret = (uint8x16_t) __builtin_neon_vqtbl1q_v((int8x16_t)__p0, (int8x16_t)__p1, 48);
60562__ai int32x4_t vtrn1q_s32(int32x4_t __p0, int32x4_t __p1) {
60563 int32x4_t __ret;
60564 __ret = __builtin_shufflevector(__p0, __p1, 0, 4, 2, 6);
6103860565 return __ret;
6103960566}
6104060567#else
61041__ai uint8x16_t vqtbl1q_u8(uint8x16_t __p0, uint8x16_t __p1) {
61042 uint8x16_t __ret;
61043 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61044 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61045 __ret = (uint8x16_t) __builtin_neon_vqtbl1q_v((int8x16_t)__rev0, (int8x16_t)__rev1, 48);
61046 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60568__ai int32x4_t vtrn1q_s32(int32x4_t __p0, int32x4_t __p1) {
60569 int32x4_t __ret;
60570 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
60571 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
60572 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 4, 2, 6);
60573 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6104760574 return __ret;
6104860575}
6104960576#endif
6105060577
6105160578#ifdef __LITTLE_ENDIAN__
61052__ai int8x16_t vqtbl1q_s8(int8x16_t __p0, uint8x16_t __p1) {
61053 int8x16_t __ret;
61054 __ret = (int8x16_t) __builtin_neon_vqtbl1q_v((int8x16_t)__p0, (int8x16_t)__p1, 32);
60579__ai int64x2_t vtrn1q_s64(int64x2_t __p0, int64x2_t __p1) {
60580 int64x2_t __ret;
60581 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
6105560582 return __ret;
6105660583}
6105760584#else
61058__ai int8x16_t vqtbl1q_s8(int8x16_t __p0, uint8x16_t __p1) {
61059 int8x16_t __ret;
61060 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61061 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61062 __ret = (int8x16_t) __builtin_neon_vqtbl1q_v((int8x16_t)__rev0, (int8x16_t)__rev1, 32);
61063 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60585__ai int64x2_t vtrn1q_s64(int64x2_t __p0, int64x2_t __p1) {
60586 int64x2_t __ret;
60587 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
60588 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
60589 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
60590 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6106460591 return __ret;
6106560592}
6106660593#endif
6106760594
6106860595#ifdef __LITTLE_ENDIAN__
61069__ai uint8x8_t vqtbl1_u8(uint8x16_t __p0, uint8x8_t __p1) {
61070 uint8x8_t __ret;
61071 __ret = (uint8x8_t) __builtin_neon_vqtbl1_v((int8x16_t)__p0, (int8x8_t)__p1, 16);
60596__ai int16x8_t vtrn1q_s16(int16x8_t __p0, int16x8_t __p1) {
60597 int16x8_t __ret;
60598 __ret = __builtin_shufflevector(__p0, __p1, 0, 8, 2, 10, 4, 12, 6, 14);
6107260599 return __ret;
6107360600}
6107460601#else
61075__ai uint8x8_t vqtbl1_u8(uint8x16_t __p0, uint8x8_t __p1) {
61076 uint8x8_t __ret;
61077 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61078 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
61079 __ret = (uint8x8_t) __builtin_neon_vqtbl1_v((int8x16_t)__rev0, (int8x8_t)__rev1, 16);
60602__ai int16x8_t vtrn1q_s16(int16x8_t __p0, int16x8_t __p1) {
60603 int16x8_t __ret;
60604 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
60605 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
60606 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 8, 2, 10, 4, 12, 6, 14);
6108060607 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6108160608 return __ret;
6108260609}
6108360610#endif
6108460611
6108560612#ifdef __LITTLE_ENDIAN__
61086__ai int8x8_t vqtbl1_s8(int8x16_t __p0, uint8x8_t __p1) {
61087 int8x8_t __ret;
61088 __ret = (int8x8_t) __builtin_neon_vqtbl1_v((int8x16_t)__p0, (int8x8_t)__p1, 0);
60613__ai uint8x8_t vtrn1_u8(uint8x8_t __p0, uint8x8_t __p1) {
60614 uint8x8_t __ret;
60615 __ret = __builtin_shufflevector(__p0, __p1, 0, 8, 2, 10, 4, 12, 6, 14);
6108960616 return __ret;
6109060617}
6109160618#else
61092__ai int8x8_t vqtbl1_s8(int8x16_t __p0, uint8x8_t __p1) {
61093 int8x8_t __ret;
61094 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60619__ai uint8x8_t vtrn1_u8(uint8x8_t __p0, uint8x8_t __p1) {
60620 uint8x8_t __ret;
60621 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
6109560622 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
61096 __ret = (int8x8_t) __builtin_neon_vqtbl1_v((int8x16_t)__rev0, (int8x8_t)__rev1, 0);
60623 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 8, 2, 10, 4, 12, 6, 14);
6109760624 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6109860625 return __ret;
6109960626}
6110060627#endif
6110160628
6110260629#ifdef __LITTLE_ENDIAN__
61103__ai poly8x8_t vqtbl2_p8(poly8x16x2_t __p0, uint8x8_t __p1) {
61104 poly8x8_t __ret;
61105 __ret = (poly8x8_t) __builtin_neon_vqtbl2_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x8_t)__p1, 4);
60630__ai uint32x2_t vtrn1_u32(uint32x2_t __p0, uint32x2_t __p1) {
60631 uint32x2_t __ret;
60632 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
6110660633 return __ret;
6110760634}
6110860635#else
61109__ai poly8x8_t vqtbl2_p8(poly8x16x2_t __p0, uint8x8_t __p1) {
61110 poly8x8_t __ret;
61111 poly8x16x2_t __rev0;
61112 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61113 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61114 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
61115 __ret = (poly8x8_t) __builtin_neon_vqtbl2_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x8_t)__rev1, 4);
61116 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
60636__ai uint32x2_t vtrn1_u32(uint32x2_t __p0, uint32x2_t __p1) {
60637 uint32x2_t __ret;
60638 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
60639 uint32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
60640 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
60641 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6111760642 return __ret;
6111860643}
6111960644#endif
6112060645
6112160646#ifdef __LITTLE_ENDIAN__
61122__ai poly8x16_t vqtbl2q_p8(poly8x16x2_t __p0, uint8x16_t __p1) {
61123 poly8x16_t __ret;
61124 __ret = (poly8x16_t) __builtin_neon_vqtbl2q_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p1, 36);
60647__ai uint16x4_t vtrn1_u16(uint16x4_t __p0, uint16x4_t __p1) {
60648 uint16x4_t __ret;
60649 __ret = __builtin_shufflevector(__p0, __p1, 0, 4, 2, 6);
6112560650 return __ret;
6112660651}
6112760652#else
61128__ai poly8x16_t vqtbl2q_p8(poly8x16x2_t __p0, uint8x16_t __p1) {
61129 poly8x16_t __ret;
61130 poly8x16x2_t __rev0;
61131 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61132 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61133 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61134 __ret = (poly8x16_t) __builtin_neon_vqtbl2q_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev1, 36);
61135 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60653__ai uint16x4_t vtrn1_u16(uint16x4_t __p0, uint16x4_t __p1) {
60654 uint16x4_t __ret;
60655 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
60656 uint16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
60657 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 4, 2, 6);
60658 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6113660659 return __ret;
6113760660}
6113860661#endif
6113960662
6114060663#ifdef __LITTLE_ENDIAN__
61141__ai uint8x16_t vqtbl2q_u8(uint8x16x2_t __p0, uint8x16_t __p1) {
61142 uint8x16_t __ret;
61143 __ret = (uint8x16_t) __builtin_neon_vqtbl2q_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p1, 48);
60664__ai int8x8_t vtrn1_s8(int8x8_t __p0, int8x8_t __p1) {
60665 int8x8_t __ret;
60666 __ret = __builtin_shufflevector(__p0, __p1, 0, 8, 2, 10, 4, 12, 6, 14);
6114460667 return __ret;
6114560668}
6114660669#else
61147__ai uint8x16_t vqtbl2q_u8(uint8x16x2_t __p0, uint8x16_t __p1) {
61148 uint8x16_t __ret;
61149 uint8x16x2_t __rev0;
61150 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61151 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61152 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61153 __ret = (uint8x16_t) __builtin_neon_vqtbl2q_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev1, 48);
61154 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60670__ai int8x8_t vtrn1_s8(int8x8_t __p0, int8x8_t __p1) {
60671 int8x8_t __ret;
60672 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
60673 int8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
60674 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 8, 2, 10, 4, 12, 6, 14);
60675 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6115560676 return __ret;
6115660677}
6115760678#endif
6115860679
6115960680#ifdef __LITTLE_ENDIAN__
61160__ai int8x16_t vqtbl2q_s8(int8x16x2_t __p0, uint8x16_t __p1) {
61161 int8x16_t __ret;
61162 __ret = (int8x16_t) __builtin_neon_vqtbl2q_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p1, 32);
60681__ai float32x2_t vtrn1_f32(float32x2_t __p0, float32x2_t __p1) {
60682 float32x2_t __ret;
60683 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
6116360684 return __ret;
6116460685}
6116560686#else
61166__ai int8x16_t vqtbl2q_s8(int8x16x2_t __p0, uint8x16_t __p1) {
61167 int8x16_t __ret;
61168 int8x16x2_t __rev0;
61169 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61170 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61171 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61172 __ret = (int8x16_t) __builtin_neon_vqtbl2q_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev1, 32);
61173 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60687__ai float32x2_t vtrn1_f32(float32x2_t __p0, float32x2_t __p1) {
60688 float32x2_t __ret;
60689 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
60690 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
60691 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
60692 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6117460693 return __ret;
6117560694}
6117660695#endif
6117760696
6117860697#ifdef __LITTLE_ENDIAN__
61179__ai uint8x8_t vqtbl2_u8(uint8x16x2_t __p0, uint8x8_t __p1) {
61180 uint8x8_t __ret;
61181 __ret = (uint8x8_t) __builtin_neon_vqtbl2_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x8_t)__p1, 16);
60698__ai int32x2_t vtrn1_s32(int32x2_t __p0, int32x2_t __p1) {
60699 int32x2_t __ret;
60700 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
6118260701 return __ret;
6118360702}
6118460703#else
61185__ai uint8x8_t vqtbl2_u8(uint8x16x2_t __p0, uint8x8_t __p1) {
61186 uint8x8_t __ret;
61187 uint8x16x2_t __rev0;
61188 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61189 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61190 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
61191 __ret = (uint8x8_t) __builtin_neon_vqtbl2_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x8_t)__rev1, 16);
61192 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
60704__ai int32x2_t vtrn1_s32(int32x2_t __p0, int32x2_t __p1) {
60705 int32x2_t __ret;
60706 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
60707 int32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
60708 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
60709 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6119360710 return __ret;
6119460711}
6119560712#endif
6119660713
6119760714#ifdef __LITTLE_ENDIAN__
61198__ai int8x8_t vqtbl2_s8(int8x16x2_t __p0, uint8x8_t __p1) {
61199 int8x8_t __ret;
61200 __ret = (int8x8_t) __builtin_neon_vqtbl2_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x8_t)__p1, 0);
60715__ai int16x4_t vtrn1_s16(int16x4_t __p0, int16x4_t __p1) {
60716 int16x4_t __ret;
60717 __ret = __builtin_shufflevector(__p0, __p1, 0, 4, 2, 6);
6120160718 return __ret;
6120260719}
6120360720#else
61204__ai int8x8_t vqtbl2_s8(int8x16x2_t __p0, uint8x8_t __p1) {
61205 int8x8_t __ret;
61206 int8x16x2_t __rev0;
61207 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61208 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61209 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
61210 __ret = (int8x8_t) __builtin_neon_vqtbl2_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x8_t)__rev1, 0);
61211 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
60721__ai int16x4_t vtrn1_s16(int16x4_t __p0, int16x4_t __p1) {
60722 int16x4_t __ret;
60723 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
60724 int16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
60725 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 4, 2, 6);
60726 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6121260727 return __ret;
6121360728}
6121460729#endif
6121560730
6121660731#ifdef __LITTLE_ENDIAN__
61217__ai poly8x8_t vqtbl3_p8(poly8x16x3_t __p0, uint8x8_t __p1) {
60732__ai poly8x8_t vtrn2_p8(poly8x8_t __p0, poly8x8_t __p1) {
6121860733 poly8x8_t __ret;
61219 __ret = (poly8x8_t) __builtin_neon_vqtbl3_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p0.val[2], (int8x8_t)__p1, 4);
60734 __ret = __builtin_shufflevector(__p0, __p1, 1, 9, 3, 11, 5, 13, 7, 15);
6122060735 return __ret;
6122160736}
6122260737#else
61223__ai poly8x8_t vqtbl3_p8(poly8x16x3_t __p0, uint8x8_t __p1) {
60738__ai poly8x8_t vtrn2_p8(poly8x8_t __p0, poly8x8_t __p1) {
6122460739 poly8x8_t __ret;
61225 poly8x16x3_t __rev0;
61226 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61227 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61228 __rev0.val[2] = __builtin_shufflevector(__p0.val[2], __p0.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61229 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
61230 __ret = (poly8x8_t) __builtin_neon_vqtbl3_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev0.val[2], (int8x8_t)__rev1, 4);
60740 poly8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
60741 poly8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
60742 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 9, 3, 11, 5, 13, 7, 15);
6123160743 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6123260744 return __ret;
6123360745}
6123460746#endif
6123560747
6123660748#ifdef __LITTLE_ENDIAN__
61237__ai poly8x16_t vqtbl3q_p8(poly8x16x3_t __p0, uint8x16_t __p1) {
61238 poly8x16_t __ret;
61239 __ret = (poly8x16_t) __builtin_neon_vqtbl3q_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p0.val[2], (int8x16_t)__p1, 36);
60749__ai poly16x4_t vtrn2_p16(poly16x4_t __p0, poly16x4_t __p1) {
60750 poly16x4_t __ret;
60751 __ret = __builtin_shufflevector(__p0, __p1, 1, 5, 3, 7);
6124060752 return __ret;
6124160753}
6124260754#else
61243__ai poly8x16_t vqtbl3q_p8(poly8x16x3_t __p0, uint8x16_t __p1) {
61244 poly8x16_t __ret;
61245 poly8x16x3_t __rev0;
61246 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61247 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61248 __rev0.val[2] = __builtin_shufflevector(__p0.val[2], __p0.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61249 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61250 __ret = (poly8x16_t) __builtin_neon_vqtbl3q_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev0.val[2], (int8x16_t)__rev1, 36);
61251 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60755__ai poly16x4_t vtrn2_p16(poly16x4_t __p0, poly16x4_t __p1) {
60756 poly16x4_t __ret;
60757 poly16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
60758 poly16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
60759 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 5, 3, 7);
60760 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6125260761 return __ret;
6125360762}
6125460763#endif
6125560764
6125660765#ifdef __LITTLE_ENDIAN__
61257__ai uint8x16_t vqtbl3q_u8(uint8x16x3_t __p0, uint8x16_t __p1) {
61258 uint8x16_t __ret;
61259 __ret = (uint8x16_t) __builtin_neon_vqtbl3q_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p0.val[2], (int8x16_t)__p1, 48);
60766__ai poly8x16_t vtrn2q_p8(poly8x16_t __p0, poly8x16_t __p1) {
60767 poly8x16_t __ret;
60768 __ret = __builtin_shufflevector(__p0, __p1, 1, 17, 3, 19, 5, 21, 7, 23, 9, 25, 11, 27, 13, 29, 15, 31);
6126060769 return __ret;
6126160770}
6126260771#else
61263__ai uint8x16_t vqtbl3q_u8(uint8x16x3_t __p0, uint8x16_t __p1) {
61264 uint8x16_t __ret;
61265 uint8x16x3_t __rev0;
61266 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61267 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61268 __rev0.val[2] = __builtin_shufflevector(__p0.val[2], __p0.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61269 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61270 __ret = (uint8x16_t) __builtin_neon_vqtbl3q_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev0.val[2], (int8x16_t)__rev1, 48);
60772__ai poly8x16_t vtrn2q_p8(poly8x16_t __p0, poly8x16_t __p1) {
60773 poly8x16_t __ret;
60774 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60775 poly8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60776 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 17, 3, 19, 5, 21, 7, 23, 9, 25, 11, 27, 13, 29, 15, 31);
6127160777 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
6127260778 return __ret;
6127360779}
6127460780#endif
6127560781
6127660782#ifdef __LITTLE_ENDIAN__
61277__ai int8x16_t vqtbl3q_s8(int8x16x3_t __p0, uint8x16_t __p1) {
61278 int8x16_t __ret;
61279 __ret = (int8x16_t) __builtin_neon_vqtbl3q_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p0.val[2], (int8x16_t)__p1, 32);
60783__ai poly64x2_t vtrn2q_p64(poly64x2_t __p0, poly64x2_t __p1) {
60784 poly64x2_t __ret;
60785 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
6128060786 return __ret;
6128160787}
6128260788#else
61283__ai int8x16_t vqtbl3q_s8(int8x16x3_t __p0, uint8x16_t __p1) {
61284 int8x16_t __ret;
61285 int8x16x3_t __rev0;
61286 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61287 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61288 __rev0.val[2] = __builtin_shufflevector(__p0.val[2], __p0.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61289 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61290 __ret = (int8x16_t) __builtin_neon_vqtbl3q_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev0.val[2], (int8x16_t)__rev1, 32);
61291 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60789__ai poly64x2_t vtrn2q_p64(poly64x2_t __p0, poly64x2_t __p1) {
60790 poly64x2_t __ret;
60791 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
60792 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
60793 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
60794 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6129260795 return __ret;
6129360796}
6129460797#endif
6129560798
6129660799#ifdef __LITTLE_ENDIAN__
61297__ai uint8x8_t vqtbl3_u8(uint8x16x3_t __p0, uint8x8_t __p1) {
61298 uint8x8_t __ret;
61299 __ret = (uint8x8_t) __builtin_neon_vqtbl3_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p0.val[2], (int8x8_t)__p1, 16);
60800__ai poly16x8_t vtrn2q_p16(poly16x8_t __p0, poly16x8_t __p1) {
60801 poly16x8_t __ret;
60802 __ret = __builtin_shufflevector(__p0, __p1, 1, 9, 3, 11, 5, 13, 7, 15);
6130060803 return __ret;
6130160804}
6130260805#else
61303__ai uint8x8_t vqtbl3_u8(uint8x16x3_t __p0, uint8x8_t __p1) {
61304 uint8x8_t __ret;
61305 uint8x16x3_t __rev0;
61306 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61307 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61308 __rev0.val[2] = __builtin_shufflevector(__p0.val[2], __p0.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61309 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
61310 __ret = (uint8x8_t) __builtin_neon_vqtbl3_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev0.val[2], (int8x8_t)__rev1, 16);
60806__ai poly16x8_t vtrn2q_p16(poly16x8_t __p0, poly16x8_t __p1) {
60807 poly16x8_t __ret;
60808 poly16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
60809 poly16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
60810 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 9, 3, 11, 5, 13, 7, 15);
6131160811 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6131260812 return __ret;
6131360813}
6131460814#endif
6131560815
6131660816#ifdef __LITTLE_ENDIAN__
61317__ai int8x8_t vqtbl3_s8(int8x16x3_t __p0, uint8x8_t __p1) {
61318 int8x8_t __ret;
61319 __ret = (int8x8_t) __builtin_neon_vqtbl3_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p0.val[2], (int8x8_t)__p1, 0);
60817__ai uint8x16_t vtrn2q_u8(uint8x16_t __p0, uint8x16_t __p1) {
60818 uint8x16_t __ret;
60819 __ret = __builtin_shufflevector(__p0, __p1, 1, 17, 3, 19, 5, 21, 7, 23, 9, 25, 11, 27, 13, 29, 15, 31);
6132060820 return __ret;
6132160821}
6132260822#else
61323__ai int8x8_t vqtbl3_s8(int8x16x3_t __p0, uint8x8_t __p1) {
61324 int8x8_t __ret;
61325 int8x16x3_t __rev0;
61326 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61327 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61328 __rev0.val[2] = __builtin_shufflevector(__p0.val[2], __p0.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61329 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
61330 __ret = (int8x8_t) __builtin_neon_vqtbl3_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev0.val[2], (int8x8_t)__rev1, 0);
61331 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
60823__ai uint8x16_t vtrn2q_u8(uint8x16_t __p0, uint8x16_t __p1) {
60824 uint8x16_t __ret;
60825 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60826 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60827 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 17, 3, 19, 5, 21, 7, 23, 9, 25, 11, 27, 13, 29, 15, 31);
60828 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
6133260829 return __ret;
6133360830}
6133460831#endif
6133560832
6133660833#ifdef __LITTLE_ENDIAN__
61337__ai poly8x8_t vqtbl4_p8(poly8x16x4_t __p0, uint8x8_t __p1) {
61338 poly8x8_t __ret;
61339 __ret = (poly8x8_t) __builtin_neon_vqtbl4_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p0.val[2], (int8x16_t)__p0.val[3], (int8x8_t)__p1, 4);
60834__ai uint32x4_t vtrn2q_u32(uint32x4_t __p0, uint32x4_t __p1) {
60835 uint32x4_t __ret;
60836 __ret = __builtin_shufflevector(__p0, __p1, 1, 5, 3, 7);
6134060837 return __ret;
6134160838}
6134260839#else
61343__ai poly8x8_t vqtbl4_p8(poly8x16x4_t __p0, uint8x8_t __p1) {
61344 poly8x8_t __ret;
61345 poly8x16x4_t __rev0;
61346 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61347 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61348 __rev0.val[2] = __builtin_shufflevector(__p0.val[2], __p0.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61349 __rev0.val[3] = __builtin_shufflevector(__p0.val[3], __p0.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61350 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
61351 __ret = (poly8x8_t) __builtin_neon_vqtbl4_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev0.val[2], (int8x16_t)__rev0.val[3], (int8x8_t)__rev1, 4);
61352 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
60840__ai uint32x4_t vtrn2q_u32(uint32x4_t __p0, uint32x4_t __p1) {
60841 uint32x4_t __ret;
60842 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
60843 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
60844 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 5, 3, 7);
60845 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6135360846 return __ret;
6135460847}
6135560848#endif
6135660849
6135760850#ifdef __LITTLE_ENDIAN__
61358__ai poly8x16_t vqtbl4q_p8(poly8x16x4_t __p0, uint8x16_t __p1) {
61359 poly8x16_t __ret;
61360 __ret = (poly8x16_t) __builtin_neon_vqtbl4q_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p0.val[2], (int8x16_t)__p0.val[3], (int8x16_t)__p1, 36);
60851__ai uint64x2_t vtrn2q_u64(uint64x2_t __p0, uint64x2_t __p1) {
60852 uint64x2_t __ret;
60853 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
6136160854 return __ret;
6136260855}
6136360856#else
61364__ai poly8x16_t vqtbl4q_p8(poly8x16x4_t __p0, uint8x16_t __p1) {
61365 poly8x16_t __ret;
61366 poly8x16x4_t __rev0;
61367 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61368 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61369 __rev0.val[2] = __builtin_shufflevector(__p0.val[2], __p0.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61370 __rev0.val[3] = __builtin_shufflevector(__p0.val[3], __p0.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61371 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61372 __ret = (poly8x16_t) __builtin_neon_vqtbl4q_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev0.val[2], (int8x16_t)__rev0.val[3], (int8x16_t)__rev1, 36);
61373 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60857__ai uint64x2_t vtrn2q_u64(uint64x2_t __p0, uint64x2_t __p1) {
60858 uint64x2_t __ret;
60859 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
60860 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
60861 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
60862 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6137460863 return __ret;
6137560864}
6137660865#endif
6137760866
6137860867#ifdef __LITTLE_ENDIAN__
61379__ai uint8x16_t vqtbl4q_u8(uint8x16x4_t __p0, uint8x16_t __p1) {
61380 uint8x16_t __ret;
61381 __ret = (uint8x16_t) __builtin_neon_vqtbl4q_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p0.val[2], (int8x16_t)__p0.val[3], (int8x16_t)__p1, 48);
60868__ai uint16x8_t vtrn2q_u16(uint16x8_t __p0, uint16x8_t __p1) {
60869 uint16x8_t __ret;
60870 __ret = __builtin_shufflevector(__p0, __p1, 1, 9, 3, 11, 5, 13, 7, 15);
6138260871 return __ret;
6138360872}
6138460873#else
61385__ai uint8x16_t vqtbl4q_u8(uint8x16x4_t __p0, uint8x16_t __p1) {
61386 uint8x16_t __ret;
61387 uint8x16x4_t __rev0;
61388 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61389 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61390 __rev0.val[2] = __builtin_shufflevector(__p0.val[2], __p0.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61391 __rev0.val[3] = __builtin_shufflevector(__p0.val[3], __p0.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61392 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61393 __ret = (uint8x16_t) __builtin_neon_vqtbl4q_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev0.val[2], (int8x16_t)__rev0.val[3], (int8x16_t)__rev1, 48);
61394 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60874__ai uint16x8_t vtrn2q_u16(uint16x8_t __p0, uint16x8_t __p1) {
60875 uint16x8_t __ret;
60876 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
60877 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
60878 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 9, 3, 11, 5, 13, 7, 15);
60879 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6139560880 return __ret;
6139660881}
6139760882#endif
6139860883
6139960884#ifdef __LITTLE_ENDIAN__
61400__ai int8x16_t vqtbl4q_s8(int8x16x4_t __p0, uint8x16_t __p1) {
60885__ai int8x16_t vtrn2q_s8(int8x16_t __p0, int8x16_t __p1) {
6140160886 int8x16_t __ret;
61402 __ret = (int8x16_t) __builtin_neon_vqtbl4q_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p0.val[2], (int8x16_t)__p0.val[3], (int8x16_t)__p1, 32);
60887 __ret = __builtin_shufflevector(__p0, __p1, 1, 17, 3, 19, 5, 21, 7, 23, 9, 25, 11, 27, 13, 29, 15, 31);
6140360888 return __ret;
6140460889}
6140560890#else
61406__ai int8x16_t vqtbl4q_s8(int8x16x4_t __p0, uint8x16_t __p1) {
60891__ai int8x16_t vtrn2q_s8(int8x16_t __p0, int8x16_t __p1) {
6140760892 int8x16_t __ret;
61408 int8x16x4_t __rev0;
61409 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61410 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61411 __rev0.val[2] = __builtin_shufflevector(__p0.val[2], __p0.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61412 __rev0.val[3] = __builtin_shufflevector(__p0.val[3], __p0.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61413 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61414 __ret = (int8x16_t) __builtin_neon_vqtbl4q_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev0.val[2], (int8x16_t)__rev0.val[3], (int8x16_t)__rev1, 32);
60893 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60894 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60895 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 17, 3, 19, 5, 21, 7, 23, 9, 25, 11, 27, 13, 29, 15, 31);
6141560896 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
6141660897 return __ret;
6141760898}
6141860899#endif
6141960900
6142060901#ifdef __LITTLE_ENDIAN__
61421__ai uint8x8_t vqtbl4_u8(uint8x16x4_t __p0, uint8x8_t __p1) {
61422 uint8x8_t __ret;
61423 __ret = (uint8x8_t) __builtin_neon_vqtbl4_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p0.val[2], (int8x16_t)__p0.val[3], (int8x8_t)__p1, 16);
60902__ai float64x2_t vtrn2q_f64(float64x2_t __p0, float64x2_t __p1) {
60903 float64x2_t __ret;
60904 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
6142460905 return __ret;
6142560906}
6142660907#else
61427__ai uint8x8_t vqtbl4_u8(uint8x16x4_t __p0, uint8x8_t __p1) {
61428 uint8x8_t __ret;
61429 uint8x16x4_t __rev0;
61430 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61431 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61432 __rev0.val[2] = __builtin_shufflevector(__p0.val[2], __p0.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61433 __rev0.val[3] = __builtin_shufflevector(__p0.val[3], __p0.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61434 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
61435 __ret = (uint8x8_t) __builtin_neon_vqtbl4_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev0.val[2], (int8x16_t)__rev0.val[3], (int8x8_t)__rev1, 16);
61436 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
60908__ai float64x2_t vtrn2q_f64(float64x2_t __p0, float64x2_t __p1) {
60909 float64x2_t __ret;
60910 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
60911 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
60912 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
60913 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6143760914 return __ret;
6143860915}
6143960916#endif
6144060917
6144160918#ifdef __LITTLE_ENDIAN__
61442__ai int8x8_t vqtbl4_s8(int8x16x4_t __p0, uint8x8_t __p1) {
61443 int8x8_t __ret;
61444 __ret = (int8x8_t) __builtin_neon_vqtbl4_v((int8x16_t)__p0.val[0], (int8x16_t)__p0.val[1], (int8x16_t)__p0.val[2], (int8x16_t)__p0.val[3], (int8x8_t)__p1, 0);
60919__ai float32x4_t vtrn2q_f32(float32x4_t __p0, float32x4_t __p1) {
60920 float32x4_t __ret;
60921 __ret = __builtin_shufflevector(__p0, __p1, 1, 5, 3, 7);
6144560922 return __ret;
6144660923}
6144760924#else
61448__ai int8x8_t vqtbl4_s8(int8x16x4_t __p0, uint8x8_t __p1) {
61449 int8x8_t __ret;
61450 int8x16x4_t __rev0;
61451 __rev0.val[0] = __builtin_shufflevector(__p0.val[0], __p0.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61452 __rev0.val[1] = __builtin_shufflevector(__p0.val[1], __p0.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61453 __rev0.val[2] = __builtin_shufflevector(__p0.val[2], __p0.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61454 __rev0.val[3] = __builtin_shufflevector(__p0.val[3], __p0.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61455 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
61456 __ret = (int8x8_t) __builtin_neon_vqtbl4_v((int8x16_t)__rev0.val[0], (int8x16_t)__rev0.val[1], (int8x16_t)__rev0.val[2], (int8x16_t)__rev0.val[3], (int8x8_t)__rev1, 0);
61457 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
60925__ai float32x4_t vtrn2q_f32(float32x4_t __p0, float32x4_t __p1) {
60926 float32x4_t __ret;
60927 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
60928 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
60929 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 5, 3, 7);
60930 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6145860931 return __ret;
6145960932}
6146060933#endif
6146160934
6146260935#ifdef __LITTLE_ENDIAN__
61463__ai poly8x8_t vqtbx1_p8(poly8x8_t __p0, poly8x16_t __p1, uint8x8_t __p2) {
61464 poly8x8_t __ret;
61465 __ret = (poly8x8_t) __builtin_neon_vqtbx1_v((int8x8_t)__p0, (int8x16_t)__p1, (int8x8_t)__p2, 4);
60936__ai int32x4_t vtrn2q_s32(int32x4_t __p0, int32x4_t __p1) {
60937 int32x4_t __ret;
60938 __ret = __builtin_shufflevector(__p0, __p1, 1, 5, 3, 7);
6146660939 return __ret;
6146760940}
6146860941#else
61469__ai poly8x8_t vqtbx1_p8(poly8x8_t __p0, poly8x16_t __p1, uint8x8_t __p2) {
61470 poly8x8_t __ret;
61471 poly8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
61472 poly8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61473 uint8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
61474 __ret = (poly8x8_t) __builtin_neon_vqtbx1_v((int8x8_t)__rev0, (int8x16_t)__rev1, (int8x8_t)__rev2, 4);
61475 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
60942__ai int32x4_t vtrn2q_s32(int32x4_t __p0, int32x4_t __p1) {
60943 int32x4_t __ret;
60944 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
60945 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
60946 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 5, 3, 7);
60947 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
60948 return __ret;
60949}
60950#endif
60951
60952#ifdef __LITTLE_ENDIAN__
60953__ai int64x2_t vtrn2q_s64(int64x2_t __p0, int64x2_t __p1) {
60954 int64x2_t __ret;
60955 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
60956 return __ret;
60957}
60958#else
60959__ai int64x2_t vtrn2q_s64(int64x2_t __p0, int64x2_t __p1) {
60960 int64x2_t __ret;
60961 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
60962 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
60963 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
60964 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6147660965 return __ret;
6147760966}
6147860967#endif
6147960968
6148060969#ifdef __LITTLE_ENDIAN__
61481__ai poly8x16_t vqtbx1q_p8(poly8x16_t __p0, poly8x16_t __p1, uint8x16_t __p2) {
61482 poly8x16_t __ret;
61483 __ret = (poly8x16_t) __builtin_neon_vqtbx1q_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 36);
60970__ai int16x8_t vtrn2q_s16(int16x8_t __p0, int16x8_t __p1) {
60971 int16x8_t __ret;
60972 __ret = __builtin_shufflevector(__p0, __p1, 1, 9, 3, 11, 5, 13, 7, 15);
6148460973 return __ret;
6148560974}
6148660975#else
61487__ai poly8x16_t vqtbx1q_p8(poly8x16_t __p0, poly8x16_t __p1, uint8x16_t __p2) {
61488 poly8x16_t __ret;
61489 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61490 poly8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61491 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61492 __ret = (poly8x16_t) __builtin_neon_vqtbx1q_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 36);
61493 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60976__ai int16x8_t vtrn2q_s16(int16x8_t __p0, int16x8_t __p1) {
60977 int16x8_t __ret;
60978 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
60979 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
60980 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 9, 3, 11, 5, 13, 7, 15);
60981 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6149460982 return __ret;
6149560983}
6149660984#endif
6149760985
6149860986#ifdef __LITTLE_ENDIAN__
61499__ai uint8x16_t vqtbx1q_u8(uint8x16_t __p0, uint8x16_t __p1, uint8x16_t __p2) {
61500 uint8x16_t __ret;
61501 __ret = (uint8x16_t) __builtin_neon_vqtbx1q_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 48);
60987__ai uint8x8_t vtrn2_u8(uint8x8_t __p0, uint8x8_t __p1) {
60988 uint8x8_t __ret;
60989 __ret = __builtin_shufflevector(__p0, __p1, 1, 9, 3, 11, 5, 13, 7, 15);
6150260990 return __ret;
6150360991}
6150460992#else
61505__ai uint8x16_t vqtbx1q_u8(uint8x16_t __p0, uint8x16_t __p1, uint8x16_t __p2) {
61506 uint8x16_t __ret;
61507 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61508 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61509 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61510 __ret = (uint8x16_t) __builtin_neon_vqtbx1q_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 48);
61511 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
60993__ai uint8x8_t vtrn2_u8(uint8x8_t __p0, uint8x8_t __p1) {
60994 uint8x8_t __ret;
60995 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
60996 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
60997 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 9, 3, 11, 5, 13, 7, 15);
60998 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6151260999 return __ret;
6151361000}
6151461001#endif
6151561002
6151661003#ifdef __LITTLE_ENDIAN__
61517__ai int8x16_t vqtbx1q_s8(int8x16_t __p0, int8x16_t __p1, uint8x16_t __p2) {
61518 int8x16_t __ret;
61519 __ret = (int8x16_t) __builtin_neon_vqtbx1q_v((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 32);
61004__ai uint32x2_t vtrn2_u32(uint32x2_t __p0, uint32x2_t __p1) {
61005 uint32x2_t __ret;
61006 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
6152061007 return __ret;
6152161008}
6152261009#else
61523__ai int8x16_t vqtbx1q_s8(int8x16_t __p0, int8x16_t __p1, uint8x16_t __p2) {
61524 int8x16_t __ret;
61525 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61526 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61527 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61528 __ret = (int8x16_t) __builtin_neon_vqtbx1q_v((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 32);
61529 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61010__ai uint32x2_t vtrn2_u32(uint32x2_t __p0, uint32x2_t __p1) {
61011 uint32x2_t __ret;
61012 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
61013 uint32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
61014 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
61015 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6153061016 return __ret;
6153161017}
6153261018#endif
6153361019
6153461020#ifdef __LITTLE_ENDIAN__
61535__ai uint8x8_t vqtbx1_u8(uint8x8_t __p0, uint8x16_t __p1, uint8x8_t __p2) {
61536 uint8x8_t __ret;
61537 __ret = (uint8x8_t) __builtin_neon_vqtbx1_v((int8x8_t)__p0, (int8x16_t)__p1, (int8x8_t)__p2, 16);
61021__ai uint16x4_t vtrn2_u16(uint16x4_t __p0, uint16x4_t __p1) {
61022 uint16x4_t __ret;
61023 __ret = __builtin_shufflevector(__p0, __p1, 1, 5, 3, 7);
6153861024 return __ret;
6153961025}
6154061026#else
61541__ai uint8x8_t vqtbx1_u8(uint8x8_t __p0, uint8x16_t __p1, uint8x8_t __p2) {
61542 uint8x8_t __ret;
61543 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
61544 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61545 uint8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
61546 __ret = (uint8x8_t) __builtin_neon_vqtbx1_v((int8x8_t)__rev0, (int8x16_t)__rev1, (int8x8_t)__rev2, 16);
61547 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
61027__ai uint16x4_t vtrn2_u16(uint16x4_t __p0, uint16x4_t __p1) {
61028 uint16x4_t __ret;
61029 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
61030 uint16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
61031 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 5, 3, 7);
61032 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6154861033 return __ret;
6154961034}
6155061035#endif
6155161036
6155261037#ifdef __LITTLE_ENDIAN__
61553__ai int8x8_t vqtbx1_s8(int8x8_t __p0, int8x16_t __p1, uint8x8_t __p2) {
61038__ai int8x8_t vtrn2_s8(int8x8_t __p0, int8x8_t __p1) {
6155461039 int8x8_t __ret;
61555 __ret = (int8x8_t) __builtin_neon_vqtbx1_v((int8x8_t)__p0, (int8x16_t)__p1, (int8x8_t)__p2, 0);
61040 __ret = __builtin_shufflevector(__p0, __p1, 1, 9, 3, 11, 5, 13, 7, 15);
6155661041 return __ret;
6155761042}
6155861043#else
61559__ai int8x8_t vqtbx1_s8(int8x8_t __p0, int8x16_t __p1, uint8x8_t __p2) {
61044__ai int8x8_t vtrn2_s8(int8x8_t __p0, int8x8_t __p1) {
6156061045 int8x8_t __ret;
6156161046 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
61562 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61563 uint8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
61564 __ret = (int8x8_t) __builtin_neon_vqtbx1_v((int8x8_t)__rev0, (int8x16_t)__rev1, (int8x8_t)__rev2, 0);
61047 int8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
61048 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 9, 3, 11, 5, 13, 7, 15);
6156561049 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6156661050 return __ret;
6156761051}
6156861052#endif
6156961053
6157061054#ifdef __LITTLE_ENDIAN__
61571__ai poly8x8_t vqtbx2_p8(poly8x8_t __p0, poly8x16x2_t __p1, uint8x8_t __p2) {
61572 poly8x8_t __ret;
61573 __ret = (poly8x8_t) __builtin_neon_vqtbx2_v((int8x8_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x8_t)__p2, 4);
61055__ai float32x2_t vtrn2_f32(float32x2_t __p0, float32x2_t __p1) {
61056 float32x2_t __ret;
61057 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
6157461058 return __ret;
6157561059}
6157661060#else
61577__ai poly8x8_t vqtbx2_p8(poly8x8_t __p0, poly8x16x2_t __p1, uint8x8_t __p2) {
61578 poly8x8_t __ret;
61579 poly8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
61580 poly8x16x2_t __rev1;
61581 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61582 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61583 uint8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
61584 __ret = (poly8x8_t) __builtin_neon_vqtbx2_v((int8x8_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x8_t)__rev2, 4);
61585 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
61061__ai float32x2_t vtrn2_f32(float32x2_t __p0, float32x2_t __p1) {
61062 float32x2_t __ret;
61063 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
61064 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
61065 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
61066 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6158661067 return __ret;
6158761068}
6158861069#endif
6158961070
6159061071#ifdef __LITTLE_ENDIAN__
61591__ai poly8x16_t vqtbx2q_p8(poly8x16_t __p0, poly8x16x2_t __p1, uint8x16_t __p2) {
61592 poly8x16_t __ret;
61593 __ret = (poly8x16_t) __builtin_neon_vqtbx2q_v((int8x16_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p2, 36);
61072__ai int32x2_t vtrn2_s32(int32x2_t __p0, int32x2_t __p1) {
61073 int32x2_t __ret;
61074 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
6159461075 return __ret;
6159561076}
6159661077#else
61597__ai poly8x16_t vqtbx2q_p8(poly8x16_t __p0, poly8x16x2_t __p1, uint8x16_t __p2) {
61598 poly8x16_t __ret;
61599 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61600 poly8x16x2_t __rev1;
61601 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61602 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61603 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61604 __ret = (poly8x16_t) __builtin_neon_vqtbx2q_v((int8x16_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev2, 36);
61605 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61078__ai int32x2_t vtrn2_s32(int32x2_t __p0, int32x2_t __p1) {
61079 int32x2_t __ret;
61080 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
61081 int32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
61082 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
61083 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6160661084 return __ret;
6160761085}
6160861086#endif
6160961087
6161061088#ifdef __LITTLE_ENDIAN__
61611__ai uint8x16_t vqtbx2q_u8(uint8x16_t __p0, uint8x16x2_t __p1, uint8x16_t __p2) {
61612 uint8x16_t __ret;
61613 __ret = (uint8x16_t) __builtin_neon_vqtbx2q_v((int8x16_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p2, 48);
61089__ai int16x4_t vtrn2_s16(int16x4_t __p0, int16x4_t __p1) {
61090 int16x4_t __ret;
61091 __ret = __builtin_shufflevector(__p0, __p1, 1, 5, 3, 7);
6161461092 return __ret;
6161561093}
6161661094#else
61617__ai uint8x16_t vqtbx2q_u8(uint8x16_t __p0, uint8x16x2_t __p1, uint8x16_t __p2) {
61618 uint8x16_t __ret;
61619 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61620 uint8x16x2_t __rev1;
61621 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61622 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61623 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61624 __ret = (uint8x16_t) __builtin_neon_vqtbx2q_v((int8x16_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev2, 48);
61625 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61095__ai int16x4_t vtrn2_s16(int16x4_t __p0, int16x4_t __p1) {
61096 int16x4_t __ret;
61097 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
61098 int16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
61099 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 5, 3, 7);
61100 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6162661101 return __ret;
6162761102}
6162861103#endif
6162961104
61105__ai uint64x1_t vtst_p64(poly64x1_t __p0, poly64x1_t __p1) {
61106 uint64x1_t __ret;
61107 __ret = (uint64x1_t) __builtin_neon_vtst_v((int8x8_t)__p0, (int8x8_t)__p1, 19);
61108 return __ret;
61109}
6163061110#ifdef __LITTLE_ENDIAN__
61631__ai int8x16_t vqtbx2q_s8(int8x16_t __p0, int8x16x2_t __p1, uint8x16_t __p2) {
61632 int8x16_t __ret;
61633 __ret = (int8x16_t) __builtin_neon_vqtbx2q_v((int8x16_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p2, 32);
61111__ai uint64x2_t vtstq_p64(poly64x2_t __p0, poly64x2_t __p1) {
61112 uint64x2_t __ret;
61113 __ret = (uint64x2_t) __builtin_neon_vtstq_v((int8x16_t)__p0, (int8x16_t)__p1, 51);
6163461114 return __ret;
6163561115}
6163661116#else
61637__ai int8x16_t vqtbx2q_s8(int8x16_t __p0, int8x16x2_t __p1, uint8x16_t __p2) {
61638 int8x16_t __ret;
61639 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61640 int8x16x2_t __rev1;
61641 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61642 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61643 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61644 __ret = (int8x16_t) __builtin_neon_vqtbx2q_v((int8x16_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev2, 32);
61645 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61117__ai uint64x2_t vtstq_p64(poly64x2_t __p0, poly64x2_t __p1) {
61118 uint64x2_t __ret;
61119 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
61120 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
61121 __ret = (uint64x2_t) __builtin_neon_vtstq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 51);
61122 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6164661123 return __ret;
6164761124}
6164861125#endif
6164961126
6165061127#ifdef __LITTLE_ENDIAN__
61651__ai uint8x8_t vqtbx2_u8(uint8x8_t __p0, uint8x16x2_t __p1, uint8x8_t __p2) {
61652 uint8x8_t __ret;
61653 __ret = (uint8x8_t) __builtin_neon_vqtbx2_v((int8x8_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x8_t)__p2, 16);
61128__ai uint64x2_t vtstq_u64(uint64x2_t __p0, uint64x2_t __p1) {
61129 uint64x2_t __ret;
61130 __ret = (uint64x2_t) __builtin_neon_vtstq_v((int8x16_t)__p0, (int8x16_t)__p1, 51);
6165461131 return __ret;
6165561132}
6165661133#else
61657__ai uint8x8_t vqtbx2_u8(uint8x8_t __p0, uint8x16x2_t __p1, uint8x8_t __p2) {
61658 uint8x8_t __ret;
61659 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
61660 uint8x16x2_t __rev1;
61661 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61662 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61663 uint8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
61664 __ret = (uint8x8_t) __builtin_neon_vqtbx2_v((int8x8_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x8_t)__rev2, 16);
61665 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
61134__ai uint64x2_t vtstq_u64(uint64x2_t __p0, uint64x2_t __p1) {
61135 uint64x2_t __ret;
61136 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
61137 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
61138 __ret = (uint64x2_t) __builtin_neon_vtstq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 51);
61139 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6166661140 return __ret;
6166761141}
6166861142#endif
6166961143
6167061144#ifdef __LITTLE_ENDIAN__
61671__ai int8x8_t vqtbx2_s8(int8x8_t __p0, int8x16x2_t __p1, uint8x8_t __p2) {
61672 int8x8_t __ret;
61673 __ret = (int8x8_t) __builtin_neon_vqtbx2_v((int8x8_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x8_t)__p2, 0);
61145__ai uint64x2_t vtstq_s64(int64x2_t __p0, int64x2_t __p1) {
61146 uint64x2_t __ret;
61147 __ret = (uint64x2_t) __builtin_neon_vtstq_v((int8x16_t)__p0, (int8x16_t)__p1, 51);
6167461148 return __ret;
6167561149}
6167661150#else
61677__ai int8x8_t vqtbx2_s8(int8x8_t __p0, int8x16x2_t __p1, uint8x8_t __p2) {
61678 int8x8_t __ret;
61679 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
61680 int8x16x2_t __rev1;
61681 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61682 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61683 uint8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
61684 __ret = (int8x8_t) __builtin_neon_vqtbx2_v((int8x8_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x8_t)__rev2, 0);
61685 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
61151__ai uint64x2_t vtstq_s64(int64x2_t __p0, int64x2_t __p1) {
61152 uint64x2_t __ret;
61153 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
61154 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
61155 __ret = (uint64x2_t) __builtin_neon_vtstq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 51);
61156 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6168661157 return __ret;
6168761158}
6168861159#endif
6168961160
61690#ifdef __LITTLE_ENDIAN__
61691__ai poly8x8_t vqtbx3_p8(poly8x8_t __p0, poly8x16x3_t __p1, uint8x8_t __p2) {
61692 poly8x8_t __ret;
61693 __ret = (poly8x8_t) __builtin_neon_vqtbx3_v((int8x8_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p1.val[2], (int8x8_t)__p2, 4);
61161__ai uint64x1_t vtst_u64(uint64x1_t __p0, uint64x1_t __p1) {
61162 uint64x1_t __ret;
61163 __ret = (uint64x1_t) __builtin_neon_vtst_v((int8x8_t)__p0, (int8x8_t)__p1, 19);
6169461164 return __ret;
6169561165}
61696#else
61697__ai poly8x8_t vqtbx3_p8(poly8x8_t __p0, poly8x16x3_t __p1, uint8x8_t __p2) {
61698 poly8x8_t __ret;
61699 poly8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
61700 poly8x16x3_t __rev1;
61701 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61702 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61703 __rev1.val[2] = __builtin_shufflevector(__p1.val[2], __p1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61704 uint8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
61705 __ret = (poly8x8_t) __builtin_neon_vqtbx3_v((int8x8_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x8_t)__rev2, 4);
61706 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
61166__ai uint64x1_t vtst_s64(int64x1_t __p0, int64x1_t __p1) {
61167 uint64x1_t __ret;
61168 __ret = (uint64x1_t) __builtin_neon_vtst_v((int8x8_t)__p0, (int8x8_t)__p1, 19);
61169 return __ret;
61170}
61171__ai uint64_t vtstd_u64(uint64_t __p0, uint64_t __p1) {
61172 uint64_t __ret;
61173 __ret = (uint64_t) __builtin_neon_vtstd_u64(__p0, __p1);
61174 return __ret;
61175}
61176__ai uint64_t vtstd_s64(int64_t __p0, int64_t __p1) {
61177 uint64_t __ret;
61178 __ret = (uint64_t) __builtin_neon_vtstd_s64(__p0, __p1);
61179 return __ret;
61180}
61181__ai int8_t vuqaddb_s8(int8_t __p0, uint8_t __p1) {
61182 int8_t __ret;
61183 __ret = (int8_t) __builtin_neon_vuqaddb_s8(__p0, __p1);
61184 return __ret;
61185}
61186__ai int32_t vuqadds_s32(int32_t __p0, uint32_t __p1) {
61187 int32_t __ret;
61188 __ret = (int32_t) __builtin_neon_vuqadds_s32(__p0, __p1);
61189 return __ret;
61190}
61191__ai int64_t vuqaddd_s64(int64_t __p0, uint64_t __p1) {
61192 int64_t __ret;
61193 __ret = (int64_t) __builtin_neon_vuqaddd_s64(__p0, __p1);
61194 return __ret;
61195}
61196__ai int16_t vuqaddh_s16(int16_t __p0, uint16_t __p1) {
61197 int16_t __ret;
61198 __ret = (int16_t) __builtin_neon_vuqaddh_s16(__p0, __p1);
6170761199 return __ret;
6170861200}
61709#endif
61710
6171161201#ifdef __LITTLE_ENDIAN__
61712__ai poly8x16_t vqtbx3q_p8(poly8x16_t __p0, poly8x16x3_t __p1, uint8x16_t __p2) {
61713 poly8x16_t __ret;
61714 __ret = (poly8x16_t) __builtin_neon_vqtbx3q_v((int8x16_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p1.val[2], (int8x16_t)__p2, 36);
61202__ai int8x16_t vuqaddq_s8(int8x16_t __p0, uint8x16_t __p1) {
61203 int8x16_t __ret;
61204 __ret = (int8x16_t) __builtin_neon_vuqaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 32);
6171561205 return __ret;
6171661206}
6171761207#else
61718__ai poly8x16_t vqtbx3q_p8(poly8x16_t __p0, poly8x16x3_t __p1, uint8x16_t __p2) {
61719 poly8x16_t __ret;
61720 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61721 poly8x16x3_t __rev1;
61722 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61723 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61724 __rev1.val[2] = __builtin_shufflevector(__p1.val[2], __p1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61725 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61726 __ret = (poly8x16_t) __builtin_neon_vqtbx3q_v((int8x16_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev2, 36);
61208__ai int8x16_t vuqaddq_s8(int8x16_t __p0, uint8x16_t __p1) {
61209 int8x16_t __ret;
61210 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61211 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61212 __ret = (int8x16_t) __builtin_neon_vuqaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 32);
6172761213 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
6172861214 return __ret;
6172961215}
6173061216#endif
6173161217
6173261218#ifdef __LITTLE_ENDIAN__
61733__ai uint8x16_t vqtbx3q_u8(uint8x16_t __p0, uint8x16x3_t __p1, uint8x16_t __p2) {
61734 uint8x16_t __ret;
61735 __ret = (uint8x16_t) __builtin_neon_vqtbx3q_v((int8x16_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p1.val[2], (int8x16_t)__p2, 48);
61219__ai int32x4_t vuqaddq_s32(int32x4_t __p0, uint32x4_t __p1) {
61220 int32x4_t __ret;
61221 __ret = (int32x4_t) __builtin_neon_vuqaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 34);
6173661222 return __ret;
6173761223}
6173861224#else
61739__ai uint8x16_t vqtbx3q_u8(uint8x16_t __p0, uint8x16x3_t __p1, uint8x16_t __p2) {
61740 uint8x16_t __ret;
61741 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61742 uint8x16x3_t __rev1;
61743 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61744 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61745 __rev1.val[2] = __builtin_shufflevector(__p1.val[2], __p1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61746 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61747 __ret = (uint8x16_t) __builtin_neon_vqtbx3q_v((int8x16_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev2, 48);
61748 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61225__ai int32x4_t vuqaddq_s32(int32x4_t __p0, uint32x4_t __p1) {
61226 int32x4_t __ret;
61227 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
61228 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
61229 __ret = (int32x4_t) __builtin_neon_vuqaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 34);
61230 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6174961231 return __ret;
6175061232}
6175161233#endif
6175261234
6175361235#ifdef __LITTLE_ENDIAN__
61754__ai int8x16_t vqtbx3q_s8(int8x16_t __p0, int8x16x3_t __p1, uint8x16_t __p2) {
61755 int8x16_t __ret;
61756 __ret = (int8x16_t) __builtin_neon_vqtbx3q_v((int8x16_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p1.val[2], (int8x16_t)__p2, 32);
61236__ai int64x2_t vuqaddq_s64(int64x2_t __p0, uint64x2_t __p1) {
61237 int64x2_t __ret;
61238 __ret = (int64x2_t) __builtin_neon_vuqaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 35);
6175761239 return __ret;
6175861240}
6175961241#else
61760__ai int8x16_t vqtbx3q_s8(int8x16_t __p0, int8x16x3_t __p1, uint8x16_t __p2) {
61761 int8x16_t __ret;
61762 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61763 int8x16x3_t __rev1;
61764 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61765 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61766 __rev1.val[2] = __builtin_shufflevector(__p1.val[2], __p1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61767 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61768 __ret = (int8x16_t) __builtin_neon_vqtbx3q_v((int8x16_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev2, 32);
61769 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61242__ai int64x2_t vuqaddq_s64(int64x2_t __p0, uint64x2_t __p1) {
61243 int64x2_t __ret;
61244 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
61245 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
61246 __ret = (int64x2_t) __builtin_neon_vuqaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 35);
61247 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6177061248 return __ret;
6177161249}
6177261250#endif
6177361251
6177461252#ifdef __LITTLE_ENDIAN__
61775__ai uint8x8_t vqtbx3_u8(uint8x8_t __p0, uint8x16x3_t __p1, uint8x8_t __p2) {
61776 uint8x8_t __ret;
61777 __ret = (uint8x8_t) __builtin_neon_vqtbx3_v((int8x8_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p1.val[2], (int8x8_t)__p2, 16);
61253__ai int16x8_t vuqaddq_s16(int16x8_t __p0, uint16x8_t __p1) {
61254 int16x8_t __ret;
61255 __ret = (int16x8_t) __builtin_neon_vuqaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 33);
6177861256 return __ret;
6177961257}
6178061258#else
61781__ai uint8x8_t vqtbx3_u8(uint8x8_t __p0, uint8x16x3_t __p1, uint8x8_t __p2) {
61782 uint8x8_t __ret;
61783 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
61784 uint8x16x3_t __rev1;
61785 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61786 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61787 __rev1.val[2] = __builtin_shufflevector(__p1.val[2], __p1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61788 uint8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
61789 __ret = (uint8x8_t) __builtin_neon_vqtbx3_v((int8x8_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x8_t)__rev2, 16);
61259__ai int16x8_t vuqaddq_s16(int16x8_t __p0, uint16x8_t __p1) {
61260 int16x8_t __ret;
61261 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
61262 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
61263 __ret = (int16x8_t) __builtin_neon_vuqaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 33);
6179061264 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6179161265 return __ret;
6179261266}
6179361267#endif
6179461268
6179561269#ifdef __LITTLE_ENDIAN__
61796__ai int8x8_t vqtbx3_s8(int8x8_t __p0, int8x16x3_t __p1, uint8x8_t __p2) {
61270__ai int8x8_t vuqadd_s8(int8x8_t __p0, uint8x8_t __p1) {
6179761271 int8x8_t __ret;
61798 __ret = (int8x8_t) __builtin_neon_vqtbx3_v((int8x8_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p1.val[2], (int8x8_t)__p2, 0);
61272 __ret = (int8x8_t) __builtin_neon_vuqadd_v((int8x8_t)__p0, (int8x8_t)__p1, 0);
6179961273 return __ret;
6180061274}
6180161275#else
61802__ai int8x8_t vqtbx3_s8(int8x8_t __p0, int8x16x3_t __p1, uint8x8_t __p2) {
61276__ai int8x8_t vuqadd_s8(int8x8_t __p0, uint8x8_t __p1) {
6180361277 int8x8_t __ret;
6180461278 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
61805 int8x16x3_t __rev1;
61806 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61807 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61808 __rev1.val[2] = __builtin_shufflevector(__p1.val[2], __p1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61809 uint8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
61810 __ret = (int8x8_t) __builtin_neon_vqtbx3_v((int8x8_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x8_t)__rev2, 0);
61279 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
61280 __ret = (int8x8_t) __builtin_neon_vuqadd_v((int8x8_t)__rev0, (int8x8_t)__rev1, 0);
6181161281 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6181261282 return __ret;
6181361283}
6181461284#endif
6181561285
6181661286#ifdef __LITTLE_ENDIAN__
61817__ai poly8x8_t vqtbx4_p8(poly8x8_t __p0, poly8x16x4_t __p1, uint8x8_t __p2) {
61818 poly8x8_t __ret;
61819 __ret = (poly8x8_t) __builtin_neon_vqtbx4_v((int8x8_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p1.val[2], (int8x16_t)__p1.val[3], (int8x8_t)__p2, 4);
61287__ai int32x2_t vuqadd_s32(int32x2_t __p0, uint32x2_t __p1) {
61288 int32x2_t __ret;
61289 __ret = (int32x2_t) __builtin_neon_vuqadd_v((int8x8_t)__p0, (int8x8_t)__p1, 2);
6182061290 return __ret;
6182161291}
6182261292#else
61823__ai poly8x8_t vqtbx4_p8(poly8x8_t __p0, poly8x16x4_t __p1, uint8x8_t __p2) {
61824 poly8x8_t __ret;
61825 poly8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
61826 poly8x16x4_t __rev1;
61827 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61828 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61829 __rev1.val[2] = __builtin_shufflevector(__p1.val[2], __p1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61830 __rev1.val[3] = __builtin_shufflevector(__p1.val[3], __p1.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61831 uint8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
61832 __ret = (poly8x8_t) __builtin_neon_vqtbx4_v((int8x8_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], (int8x8_t)__rev2, 4);
61833 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
61293__ai int32x2_t vuqadd_s32(int32x2_t __p0, uint32x2_t __p1) {
61294 int32x2_t __ret;
61295 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
61296 uint32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
61297 __ret = (int32x2_t) __builtin_neon_vuqadd_v((int8x8_t)__rev0, (int8x8_t)__rev1, 2);
61298 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6183461299 return __ret;
6183561300}
6183661301#endif
6183761302
61303__ai int64x1_t vuqadd_s64(int64x1_t __p0, uint64x1_t __p1) {
61304 int64x1_t __ret;
61305 __ret = (int64x1_t) __builtin_neon_vuqadd_v((int8x8_t)__p0, (int8x8_t)__p1, 3);
61306 return __ret;
61307}
6183861308#ifdef __LITTLE_ENDIAN__
61839__ai poly8x16_t vqtbx4q_p8(poly8x16_t __p0, poly8x16x4_t __p1, uint8x16_t __p2) {
61840 poly8x16_t __ret;
61841 __ret = (poly8x16_t) __builtin_neon_vqtbx4q_v((int8x16_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p1.val[2], (int8x16_t)__p1.val[3], (int8x16_t)__p2, 36);
61309__ai int16x4_t vuqadd_s16(int16x4_t __p0, uint16x4_t __p1) {
61310 int16x4_t __ret;
61311 __ret = (int16x4_t) __builtin_neon_vuqadd_v((int8x8_t)__p0, (int8x8_t)__p1, 1);
6184261312 return __ret;
6184361313}
6184461314#else
61845__ai poly8x16_t vqtbx4q_p8(poly8x16_t __p0, poly8x16x4_t __p1, uint8x16_t __p2) {
61846 poly8x16_t __ret;
61847 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61848 poly8x16x4_t __rev1;
61849 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61850 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61851 __rev1.val[2] = __builtin_shufflevector(__p1.val[2], __p1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61852 __rev1.val[3] = __builtin_shufflevector(__p1.val[3], __p1.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61853 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61854 __ret = (poly8x16_t) __builtin_neon_vqtbx4q_v((int8x16_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], (int8x16_t)__rev2, 36);
61855 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61315__ai int16x4_t vuqadd_s16(int16x4_t __p0, uint16x4_t __p1) {
61316 int16x4_t __ret;
61317 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
61318 uint16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
61319 __ret = (int16x4_t) __builtin_neon_vuqadd_v((int8x8_t)__rev0, (int8x8_t)__rev1, 1);
61320 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6185661321 return __ret;
6185761322}
6185861323#endif
6185961324
6186061325#ifdef __LITTLE_ENDIAN__
61861__ai uint8x16_t vqtbx4q_u8(uint8x16_t __p0, uint8x16x4_t __p1, uint8x16_t __p2) {
61862 uint8x16_t __ret;
61863 __ret = (uint8x16_t) __builtin_neon_vqtbx4q_v((int8x16_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p1.val[2], (int8x16_t)__p1.val[3], (int8x16_t)__p2, 48);
61326__ai poly8x8_t vuzp1_p8(poly8x8_t __p0, poly8x8_t __p1) {
61327 poly8x8_t __ret;
61328 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6, 8, 10, 12, 14);
6186461329 return __ret;
6186561330}
6186661331#else
61867__ai uint8x16_t vqtbx4q_u8(uint8x16_t __p0, uint8x16x4_t __p1, uint8x16_t __p2) {
61868 uint8x16_t __ret;
61869 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61870 uint8x16x4_t __rev1;
61871 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61872 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61873 __rev1.val[2] = __builtin_shufflevector(__p1.val[2], __p1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61874 __rev1.val[3] = __builtin_shufflevector(__p1.val[3], __p1.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61875 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61876 __ret = (uint8x16_t) __builtin_neon_vqtbx4q_v((int8x16_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], (int8x16_t)__rev2, 48);
61877 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61332__ai poly8x8_t vuzp1_p8(poly8x8_t __p0, poly8x8_t __p1) {
61333 poly8x8_t __ret;
61334 poly8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
61335 poly8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
61336 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6, 8, 10, 12, 14);
61337 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6187861338 return __ret;
6187961339}
6188061340#endif
6188161341
6188261342#ifdef __LITTLE_ENDIAN__
61883__ai int8x16_t vqtbx4q_s8(int8x16_t __p0, int8x16x4_t __p1, uint8x16_t __p2) {
61884 int8x16_t __ret;
61885 __ret = (int8x16_t) __builtin_neon_vqtbx4q_v((int8x16_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p1.val[2], (int8x16_t)__p1.val[3], (int8x16_t)__p2, 32);
61343__ai poly16x4_t vuzp1_p16(poly16x4_t __p0, poly16x4_t __p1) {
61344 poly16x4_t __ret;
61345 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6);
6188661346 return __ret;
6188761347}
6188861348#else
61889__ai int8x16_t vqtbx4q_s8(int8x16_t __p0, int8x16x4_t __p1, uint8x16_t __p2) {
61890 int8x16_t __ret;
61891 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61892 int8x16x4_t __rev1;
61893 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61894 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61895 __rev1.val[2] = __builtin_shufflevector(__p1.val[2], __p1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61896 __rev1.val[3] = __builtin_shufflevector(__p1.val[3], __p1.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61897 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61898 __ret = (int8x16_t) __builtin_neon_vqtbx4q_v((int8x16_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], (int8x16_t)__rev2, 32);
61349__ai poly16x4_t vuzp1_p16(poly16x4_t __p0, poly16x4_t __p1) {
61350 poly16x4_t __ret;
61351 poly16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
61352 poly16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
61353 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6);
61354 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
61355 return __ret;
61356}
61357#endif
61358
61359#ifdef __LITTLE_ENDIAN__
61360__ai poly8x16_t vuzp1q_p8(poly8x16_t __p0, poly8x16_t __p1) {
61361 poly8x16_t __ret;
61362 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6, 8, 10, 12, 14, 16, 18, 20, 22, 24, 26, 28, 30);
61363 return __ret;
61364}
61365#else
61366__ai poly8x16_t vuzp1q_p8(poly8x16_t __p0, poly8x16_t __p1) {
61367 poly8x16_t __ret;
61368 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61369 poly8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61370 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6, 8, 10, 12, 14, 16, 18, 20, 22, 24, 26, 28, 30);
6189961371 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
6190061372 return __ret;
6190161373}
6190261374#endif
6190361375
6190461376#ifdef __LITTLE_ENDIAN__
61905__ai uint8x8_t vqtbx4_u8(uint8x8_t __p0, uint8x16x4_t __p1, uint8x8_t __p2) {
61906 uint8x8_t __ret;
61907 __ret = (uint8x8_t) __builtin_neon_vqtbx4_v((int8x8_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p1.val[2], (int8x16_t)__p1.val[3], (int8x8_t)__p2, 16);
61377__ai poly64x2_t vuzp1q_p64(poly64x2_t __p0, poly64x2_t __p1) {
61378 poly64x2_t __ret;
61379 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
6190861380 return __ret;
6190961381}
6191061382#else
61911__ai uint8x8_t vqtbx4_u8(uint8x8_t __p0, uint8x16x4_t __p1, uint8x8_t __p2) {
61912 uint8x8_t __ret;
61913 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
61914 uint8x16x4_t __rev1;
61915 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61916 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61917 __rev1.val[2] = __builtin_shufflevector(__p1.val[2], __p1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61918 __rev1.val[3] = __builtin_shufflevector(__p1.val[3], __p1.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61919 uint8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
61920 __ret = (uint8x8_t) __builtin_neon_vqtbx4_v((int8x8_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], (int8x8_t)__rev2, 16);
61921 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
61383__ai poly64x2_t vuzp1q_p64(poly64x2_t __p0, poly64x2_t __p1) {
61384 poly64x2_t __ret;
61385 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
61386 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
61387 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
61388 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6192261389 return __ret;
6192361390}
6192461391#endif
6192561392
6192661393#ifdef __LITTLE_ENDIAN__
61927__ai int8x8_t vqtbx4_s8(int8x8_t __p0, int8x16x4_t __p1, uint8x8_t __p2) {
61928 int8x8_t __ret;
61929 __ret = (int8x8_t) __builtin_neon_vqtbx4_v((int8x8_t)__p0, (int8x16_t)__p1.val[0], (int8x16_t)__p1.val[1], (int8x16_t)__p1.val[2], (int8x16_t)__p1.val[3], (int8x8_t)__p2, 0);
61394__ai poly16x8_t vuzp1q_p16(poly16x8_t __p0, poly16x8_t __p1) {
61395 poly16x8_t __ret;
61396 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6, 8, 10, 12, 14);
6193061397 return __ret;
6193161398}
6193261399#else
61933__ai int8x8_t vqtbx4_s8(int8x8_t __p0, int8x16x4_t __p1, uint8x8_t __p2) {
61934 int8x8_t __ret;
61935 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
61936 int8x16x4_t __rev1;
61937 __rev1.val[0] = __builtin_shufflevector(__p1.val[0], __p1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61938 __rev1.val[1] = __builtin_shufflevector(__p1.val[1], __p1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61939 __rev1.val[2] = __builtin_shufflevector(__p1.val[2], __p1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61940 __rev1.val[3] = __builtin_shufflevector(__p1.val[3], __p1.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61941 uint8x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
61942 __ret = (int8x8_t) __builtin_neon_vqtbx4_v((int8x8_t)__rev0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], (int8x8_t)__rev2, 0);
61400__ai poly16x8_t vuzp1q_p16(poly16x8_t __p0, poly16x8_t __p1) {
61401 poly16x8_t __ret;
61402 poly16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
61403 poly16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
61404 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6, 8, 10, 12, 14);
6194361405 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6194461406 return __ret;
6194561407}
6194661408#endif
6194761409
6194861410#ifdef __LITTLE_ENDIAN__
61949__ai uint16x8_t vraddhn_high_u32(uint16x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
61950 uint16x8_t __ret;
61951 __ret = vcombine_u16(__p0, vraddhn_u32(__p1, __p2));
61411__ai uint8x16_t vuzp1q_u8(uint8x16_t __p0, uint8x16_t __p1) {
61412 uint8x16_t __ret;
61413 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6, 8, 10, 12, 14, 16, 18, 20, 22, 24, 26, 28, 30);
6195261414 return __ret;
6195361415}
6195461416#else
61955__ai uint16x8_t vraddhn_high_u32(uint16x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
61956 uint16x8_t __ret;
61957 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
61958 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
61959 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
61960 __ret = __noswap_vcombine_u16(__rev0, __noswap_vraddhn_u32(__rev1, __rev2));
61961 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
61417__ai uint8x16_t vuzp1q_u8(uint8x16_t __p0, uint8x16_t __p1) {
61418 uint8x16_t __ret;
61419 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61420 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61421 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6, 8, 10, 12, 14, 16, 18, 20, 22, 24, 26, 28, 30);
61422 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
6196261423 return __ret;
6196361424}
6196461425#endif
6196561426
6196661427#ifdef __LITTLE_ENDIAN__
61967__ai uint32x4_t vraddhn_high_u64(uint32x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
61428__ai uint32x4_t vuzp1q_u32(uint32x4_t __p0, uint32x4_t __p1) {
6196861429 uint32x4_t __ret;
61969 __ret = vcombine_u32(__p0, vraddhn_u64(__p1, __p2));
61430 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6);
6197061431 return __ret;
6197161432}
6197261433#else
61973__ai uint32x4_t vraddhn_high_u64(uint32x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
61434__ai uint32x4_t vuzp1q_u32(uint32x4_t __p0, uint32x4_t __p1) {
6197461435 uint32x4_t __ret;
61975 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
61976 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
61977 uint64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
61978 __ret = __noswap_vcombine_u32(__rev0, __noswap_vraddhn_u64(__rev1, __rev2));
61436 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
61437 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
61438 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6);
6197961439 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6198061440 return __ret;
6198161441}
6198261442#endif
6198361443
6198461444#ifdef __LITTLE_ENDIAN__
61985__ai uint8x16_t vraddhn_high_u16(uint8x8_t __p0, uint16x8_t __p1, uint16x8_t __p2) {
61986 uint8x16_t __ret;
61987 __ret = vcombine_u8(__p0, vraddhn_u16(__p1, __p2));
61445__ai uint64x2_t vuzp1q_u64(uint64x2_t __p0, uint64x2_t __p1) {
61446 uint64x2_t __ret;
61447 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
6198861448 return __ret;
6198961449}
6199061450#else
61991__ai uint8x16_t vraddhn_high_u16(uint8x8_t __p0, uint16x8_t __p1, uint16x8_t __p2) {
61992 uint8x16_t __ret;
61993 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
61994 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
61995 uint16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
61996 __ret = __noswap_vcombine_u8(__rev0, __noswap_vraddhn_u16(__rev1, __rev2));
61997 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61451__ai uint64x2_t vuzp1q_u64(uint64x2_t __p0, uint64x2_t __p1) {
61452 uint64x2_t __ret;
61453 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
61454 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
61455 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
61456 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6199861457 return __ret;
6199961458}
6200061459#endif
6200161460
6200261461#ifdef __LITTLE_ENDIAN__
62003__ai int16x8_t vraddhn_high_s32(int16x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
62004 int16x8_t __ret;
62005 __ret = vcombine_s16(__p0, vraddhn_s32(__p1, __p2));
61462__ai uint16x8_t vuzp1q_u16(uint16x8_t __p0, uint16x8_t __p1) {
61463 uint16x8_t __ret;
61464 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6, 8, 10, 12, 14);
6200661465 return __ret;
6200761466}
6200861467#else
62009__ai int16x8_t vraddhn_high_s32(int16x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
62010 int16x8_t __ret;
62011 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
62012 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
62013 int32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
62014 __ret = __noswap_vcombine_s16(__rev0, __noswap_vraddhn_s32(__rev1, __rev2));
61468__ai uint16x8_t vuzp1q_u16(uint16x8_t __p0, uint16x8_t __p1) {
61469 uint16x8_t __ret;
61470 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
61471 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
61472 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6, 8, 10, 12, 14);
6201561473 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6201661474 return __ret;
6201761475}
6201861476#endif
6201961477
6202061478#ifdef __LITTLE_ENDIAN__
62021__ai int32x4_t vraddhn_high_s64(int32x2_t __p0, int64x2_t __p1, int64x2_t __p2) {
62022 int32x4_t __ret;
62023 __ret = vcombine_s32(__p0, vraddhn_s64(__p1, __p2));
61479__ai int8x16_t vuzp1q_s8(int8x16_t __p0, int8x16_t __p1) {
61480 int8x16_t __ret;
61481 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6, 8, 10, 12, 14, 16, 18, 20, 22, 24, 26, 28, 30);
6202461482 return __ret;
6202561483}
6202661484#else
62027__ai int32x4_t vraddhn_high_s64(int32x2_t __p0, int64x2_t __p1, int64x2_t __p2) {
62028 int32x4_t __ret;
62029 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
62030 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
62031 int64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
62032 __ret = __noswap_vcombine_s32(__rev0, __noswap_vraddhn_s64(__rev1, __rev2));
62033 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
61485__ai int8x16_t vuzp1q_s8(int8x16_t __p0, int8x16_t __p1) {
61486 int8x16_t __ret;
61487 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61488 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61489 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6, 8, 10, 12, 14, 16, 18, 20, 22, 24, 26, 28, 30);
61490 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
6203461491 return __ret;
6203561492}
6203661493#endif
6203761494
6203861495#ifdef __LITTLE_ENDIAN__
62039__ai int8x16_t vraddhn_high_s16(int8x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
62040 int8x16_t __ret;
62041 __ret = vcombine_s8(__p0, vraddhn_s16(__p1, __p2));
61496__ai float64x2_t vuzp1q_f64(float64x2_t __p0, float64x2_t __p1) {
61497 float64x2_t __ret;
61498 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
6204261499 return __ret;
6204361500}
6204461501#else
62045__ai int8x16_t vraddhn_high_s16(int8x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
62046 int8x16_t __ret;
62047 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
62048 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
62049 int16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
62050 __ret = __noswap_vcombine_s8(__rev0, __noswap_vraddhn_s16(__rev1, __rev2));
62051 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61502__ai float64x2_t vuzp1q_f64(float64x2_t __p0, float64x2_t __p1) {
61503 float64x2_t __ret;
61504 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
61505 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
61506 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
61507 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6205261508 return __ret;
6205361509}
6205461510#endif
6205561511
6205661512#ifdef __LITTLE_ENDIAN__
62057__ai poly8x8_t vrbit_p8(poly8x8_t __p0) {
62058 poly8x8_t __ret;
62059 __ret = (poly8x8_t) __builtin_neon_vrbit_v((int8x8_t)__p0, 4);
61513__ai float32x4_t vuzp1q_f32(float32x4_t __p0, float32x4_t __p1) {
61514 float32x4_t __ret;
61515 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6);
6206061516 return __ret;
6206161517}
6206261518#else
62063__ai poly8x8_t vrbit_p8(poly8x8_t __p0) {
62064 poly8x8_t __ret;
62065 poly8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
62066 __ret = (poly8x8_t) __builtin_neon_vrbit_v((int8x8_t)__rev0, 4);
62067 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
61519__ai float32x4_t vuzp1q_f32(float32x4_t __p0, float32x4_t __p1) {
61520 float32x4_t __ret;
61521 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
61522 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
61523 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6);
61524 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6206861525 return __ret;
6206961526}
6207061527#endif
6207161528
6207261529#ifdef __LITTLE_ENDIAN__
62073__ai poly8x16_t vrbitq_p8(poly8x16_t __p0) {
62074 poly8x16_t __ret;
62075 __ret = (poly8x16_t) __builtin_neon_vrbitq_v((int8x16_t)__p0, 36);
61530__ai int32x4_t vuzp1q_s32(int32x4_t __p0, int32x4_t __p1) {
61531 int32x4_t __ret;
61532 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6);
6207661533 return __ret;
6207761534}
6207861535#else
62079__ai poly8x16_t vrbitq_p8(poly8x16_t __p0) {
62080 poly8x16_t __ret;
62081 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
62082 __ret = (poly8x16_t) __builtin_neon_vrbitq_v((int8x16_t)__rev0, 36);
62083 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61536__ai int32x4_t vuzp1q_s32(int32x4_t __p0, int32x4_t __p1) {
61537 int32x4_t __ret;
61538 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
61539 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
61540 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6);
61541 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6208461542 return __ret;
6208561543}
6208661544#endif
6208761545
6208861546#ifdef __LITTLE_ENDIAN__
62089__ai uint8x16_t vrbitq_u8(uint8x16_t __p0) {
62090 uint8x16_t __ret;
62091 __ret = (uint8x16_t) __builtin_neon_vrbitq_v((int8x16_t)__p0, 48);
61547__ai int64x2_t vuzp1q_s64(int64x2_t __p0, int64x2_t __p1) {
61548 int64x2_t __ret;
61549 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
6209261550 return __ret;
6209361551}
6209461552#else
62095__ai uint8x16_t vrbitq_u8(uint8x16_t __p0) {
62096 uint8x16_t __ret;
62097 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
62098 __ret = (uint8x16_t) __builtin_neon_vrbitq_v((int8x16_t)__rev0, 48);
62099 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61553__ai int64x2_t vuzp1q_s64(int64x2_t __p0, int64x2_t __p1) {
61554 int64x2_t __ret;
61555 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
61556 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
61557 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
61558 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6210061559 return __ret;
6210161560}
6210261561#endif
6210361562
6210461563#ifdef __LITTLE_ENDIAN__
62105__ai int8x16_t vrbitq_s8(int8x16_t __p0) {
62106 int8x16_t __ret;
62107 __ret = (int8x16_t) __builtin_neon_vrbitq_v((int8x16_t)__p0, 32);
61564__ai int16x8_t vuzp1q_s16(int16x8_t __p0, int16x8_t __p1) {
61565 int16x8_t __ret;
61566 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6, 8, 10, 12, 14);
6210861567 return __ret;
6210961568}
6211061569#else
62111__ai int8x16_t vrbitq_s8(int8x16_t __p0) {
62112 int8x16_t __ret;
62113 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
62114 __ret = (int8x16_t) __builtin_neon_vrbitq_v((int8x16_t)__rev0, 32);
62115 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61570__ai int16x8_t vuzp1q_s16(int16x8_t __p0, int16x8_t __p1) {
61571 int16x8_t __ret;
61572 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
61573 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
61574 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6, 8, 10, 12, 14);
61575 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6211661576 return __ret;
6211761577}
6211861578#endif
6211961579
6212061580#ifdef __LITTLE_ENDIAN__
62121__ai uint8x8_t vrbit_u8(uint8x8_t __p0) {
61581__ai uint8x8_t vuzp1_u8(uint8x8_t __p0, uint8x8_t __p1) {
6212261582 uint8x8_t __ret;
62123 __ret = (uint8x8_t) __builtin_neon_vrbit_v((int8x8_t)__p0, 16);
61583 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6, 8, 10, 12, 14);
6212461584 return __ret;
6212561585}
6212661586#else
62127__ai uint8x8_t vrbit_u8(uint8x8_t __p0) {
61587__ai uint8x8_t vuzp1_u8(uint8x8_t __p0, uint8x8_t __p1) {
6212861588 uint8x8_t __ret;
6212961589 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
62130 __ret = (uint8x8_t) __builtin_neon_vrbit_v((int8x8_t)__rev0, 16);
61590 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
61591 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6, 8, 10, 12, 14);
6213161592 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6213261593 return __ret;
6213361594}
6213461595#endif
6213561596
6213661597#ifdef __LITTLE_ENDIAN__
62137__ai int8x8_t vrbit_s8(int8x8_t __p0) {
62138 int8x8_t __ret;
62139 __ret = (int8x8_t) __builtin_neon_vrbit_v((int8x8_t)__p0, 0);
61598__ai uint32x2_t vuzp1_u32(uint32x2_t __p0, uint32x2_t __p1) {
61599 uint32x2_t __ret;
61600 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
6214061601 return __ret;
6214161602}
6214261603#else
62143__ai int8x8_t vrbit_s8(int8x8_t __p0) {
62144 int8x8_t __ret;
62145 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
62146 __ret = (int8x8_t) __builtin_neon_vrbit_v((int8x8_t)__rev0, 0);
62147 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
61604__ai uint32x2_t vuzp1_u32(uint32x2_t __p0, uint32x2_t __p1) {
61605 uint32x2_t __ret;
61606 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
61607 uint32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
61608 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
61609 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6214861610 return __ret;
6214961611}
6215061612#endif
6215161613
6215261614#ifdef __LITTLE_ENDIAN__
62153__ai float64x2_t vrecpeq_f64(float64x2_t __p0) {
62154 float64x2_t __ret;
62155 __ret = (float64x2_t) __builtin_neon_vrecpeq_v((int8x16_t)__p0, 42);
61615__ai uint16x4_t vuzp1_u16(uint16x4_t __p0, uint16x4_t __p1) {
61616 uint16x4_t __ret;
61617 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6);
6215661618 return __ret;
6215761619}
6215861620#else
62159__ai float64x2_t vrecpeq_f64(float64x2_t __p0) {
62160 float64x2_t __ret;
62161 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
62162 __ret = (float64x2_t) __builtin_neon_vrecpeq_v((int8x16_t)__rev0, 42);
62163 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
61621__ai uint16x4_t vuzp1_u16(uint16x4_t __p0, uint16x4_t __p1) {
61622 uint16x4_t __ret;
61623 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
61624 uint16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
61625 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6);
61626 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6216461627 return __ret;
6216561628}
6216661629#endif
6216761630
62168__ai float64x1_t vrecpe_f64(float64x1_t __p0) {
62169 float64x1_t __ret;
62170 __ret = (float64x1_t) __builtin_neon_vrecpe_v((int8x8_t)__p0, 10);
62171 return __ret;
62172}
62173__ai float64_t vrecped_f64(float64_t __p0) {
62174 float64_t __ret;
62175 __ret = (float64_t) __builtin_neon_vrecped_f64(__p0);
61631#ifdef __LITTLE_ENDIAN__
61632__ai int8x8_t vuzp1_s8(int8x8_t __p0, int8x8_t __p1) {
61633 int8x8_t __ret;
61634 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6, 8, 10, 12, 14);
6217661635 return __ret;
6217761636}
62178__ai float32_t vrecpes_f32(float32_t __p0) {
62179 float32_t __ret;
62180 __ret = (float32_t) __builtin_neon_vrecpes_f32(__p0);
61637#else
61638__ai int8x8_t vuzp1_s8(int8x8_t __p0, int8x8_t __p1) {
61639 int8x8_t __ret;
61640 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
61641 int8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
61642 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6, 8, 10, 12, 14);
61643 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6218161644 return __ret;
6218261645}
61646#endif
61647
6218361648#ifdef __LITTLE_ENDIAN__
62184__ai float64x2_t vrecpsq_f64(float64x2_t __p0, float64x2_t __p1) {
62185 float64x2_t __ret;
62186 __ret = (float64x2_t) __builtin_neon_vrecpsq_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
61649__ai float32x2_t vuzp1_f32(float32x2_t __p0, float32x2_t __p1) {
61650 float32x2_t __ret;
61651 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
6218761652 return __ret;
6218861653}
6218961654#else
62190__ai float64x2_t vrecpsq_f64(float64x2_t __p0, float64x2_t __p1) {
62191 float64x2_t __ret;
62192 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
62193 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
62194 __ret = (float64x2_t) __builtin_neon_vrecpsq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
61655__ai float32x2_t vuzp1_f32(float32x2_t __p0, float32x2_t __p1) {
61656 float32x2_t __ret;
61657 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
61658 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
61659 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
6219561660 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6219661661 return __ret;
6219761662}
6219861663#endif
6219961664
62200__ai float64x1_t vrecps_f64(float64x1_t __p0, float64x1_t __p1) {
62201 float64x1_t __ret;
62202 __ret = (float64x1_t) __builtin_neon_vrecps_v((int8x8_t)__p0, (int8x8_t)__p1, 10);
61665#ifdef __LITTLE_ENDIAN__
61666__ai int32x2_t vuzp1_s32(int32x2_t __p0, int32x2_t __p1) {
61667 int32x2_t __ret;
61668 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
6220361669 return __ret;
6220461670}
62205__ai float64_t vrecpsd_f64(float64_t __p0, float64_t __p1) {
62206 float64_t __ret;
62207 __ret = (float64_t) __builtin_neon_vrecpsd_f64(__p0, __p1);
61671#else
61672__ai int32x2_t vuzp1_s32(int32x2_t __p0, int32x2_t __p1) {
61673 int32x2_t __ret;
61674 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
61675 int32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
61676 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
61677 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6220861678 return __ret;
6220961679}
62210__ai float32_t vrecpss_f32(float32_t __p0, float32_t __p1) {
62211 float32_t __ret;
62212 __ret = (float32_t) __builtin_neon_vrecpss_f32(__p0, __p1);
61680#endif
61681
61682#ifdef __LITTLE_ENDIAN__
61683__ai int16x4_t vuzp1_s16(int16x4_t __p0, int16x4_t __p1) {
61684 int16x4_t __ret;
61685 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6);
6221361686 return __ret;
6221461687}
62215__ai float64_t vrecpxd_f64(float64_t __p0) {
62216 float64_t __ret;
62217 __ret = (float64_t) __builtin_neon_vrecpxd_f64(__p0);
61688#else
61689__ai int16x4_t vuzp1_s16(int16x4_t __p0, int16x4_t __p1) {
61690 int16x4_t __ret;
61691 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
61692 int16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
61693 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6);
61694 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6221861695 return __ret;
6221961696}
62220__ai float32_t vrecpxs_f32(float32_t __p0) {
62221 float32_t __ret;
62222 __ret = (float32_t) __builtin_neon_vrecpxs_f32(__p0);
61697#endif
61698
61699#ifdef __LITTLE_ENDIAN__
61700__ai poly8x8_t vuzp2_p8(poly8x8_t __p0, poly8x8_t __p1) {
61701 poly8x8_t __ret;
61702 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7, 9, 11, 13, 15);
6222361703 return __ret;
6222461704}
62225__ai uint64_t vrshld_u64(uint64_t __p0, int64_t __p1) {
62226 uint64_t __ret;
62227 __ret = (uint64_t) __builtin_neon_vrshld_u64(__p0, __p1);
61705#else
61706__ai poly8x8_t vuzp2_p8(poly8x8_t __p0, poly8x8_t __p1) {
61707 poly8x8_t __ret;
61708 poly8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
61709 poly8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
61710 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7, 9, 11, 13, 15);
61711 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6222861712 return __ret;
6222961713}
62230__ai int64_t vrshld_s64(int64_t __p0, int64_t __p1) {
62231 int64_t __ret;
62232 __ret = (int64_t) __builtin_neon_vrshld_s64(__p0, __p1);
61714#endif
61715
61716#ifdef __LITTLE_ENDIAN__
61717__ai poly16x4_t vuzp2_p16(poly16x4_t __p0, poly16x4_t __p1) {
61718 poly16x4_t __ret;
61719 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7);
6223361720 return __ret;
6223461721}
62235#define vrshrd_n_u64(__p0, __p1) __extension__ ({ \
62236 uint64_t __ret; \
62237 uint64_t __s0 = __p0; \
62238 __ret = (uint64_t) __builtin_neon_vrshrd_n_u64(__s0, __p1); \
62239 __ret; \
62240})
62241#define vrshrd_n_s64(__p0, __p1) __extension__ ({ \
62242 int64_t __ret; \
62243 int64_t __s0 = __p0; \
62244 __ret = (int64_t) __builtin_neon_vrshrd_n_s64(__s0, __p1); \
62245 __ret; \
62246})
62247#ifdef __LITTLE_ENDIAN__
62248#define vrshrn_high_n_u32(__p0_807, __p1_807, __p2_807) __extension__ ({ \
62249 uint16x8_t __ret_807; \
62250 uint16x4_t __s0_807 = __p0_807; \
62251 uint32x4_t __s1_807 = __p1_807; \
62252 __ret_807 = (uint16x8_t)(vcombine_u16((uint16x4_t)(__s0_807), (uint16x4_t)(vrshrn_n_u32(__s1_807, __p2_807)))); \
62253 __ret_807; \
62254})
6225561722#else
62256#define vrshrn_high_n_u32(__p0_808, __p1_808, __p2_808) __extension__ ({ \
62257 uint16x8_t __ret_808; \
62258 uint16x4_t __s0_808 = __p0_808; \
62259 uint32x4_t __s1_808 = __p1_808; \
62260 uint16x4_t __rev0_808; __rev0_808 = __builtin_shufflevector(__s0_808, __s0_808, 3, 2, 1, 0); \
62261 uint32x4_t __rev1_808; __rev1_808 = __builtin_shufflevector(__s1_808, __s1_808, 3, 2, 1, 0); \
62262 __ret_808 = (uint16x8_t)(__noswap_vcombine_u16((uint16x4_t)(__rev0_808), (uint16x4_t)(__noswap_vrshrn_n_u32(__rev1_808, __p2_808)))); \
62263 __ret_808 = __builtin_shufflevector(__ret_808, __ret_808, 7, 6, 5, 4, 3, 2, 1, 0); \
62264 __ret_808; \
62265})
61723__ai poly16x4_t vuzp2_p16(poly16x4_t __p0, poly16x4_t __p1) {
61724 poly16x4_t __ret;
61725 poly16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
61726 poly16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
61727 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7);
61728 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
61729 return __ret;
61730}
6226661731#endif
6226761732
6226861733#ifdef __LITTLE_ENDIAN__
62269#define vrshrn_high_n_u64(__p0_809, __p1_809, __p2_809) __extension__ ({ \
62270 uint32x4_t __ret_809; \
62271 uint32x2_t __s0_809 = __p0_809; \
62272 uint64x2_t __s1_809 = __p1_809; \
62273 __ret_809 = (uint32x4_t)(vcombine_u32((uint32x2_t)(__s0_809), (uint32x2_t)(vrshrn_n_u64(__s1_809, __p2_809)))); \
62274 __ret_809; \
62275})
61734__ai poly8x16_t vuzp2q_p8(poly8x16_t __p0, poly8x16_t __p1) {
61735 poly8x16_t __ret;
61736 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7, 9, 11, 13, 15, 17, 19, 21, 23, 25, 27, 29, 31);
61737 return __ret;
61738}
6227661739#else
62277#define vrshrn_high_n_u64(__p0_810, __p1_810, __p2_810) __extension__ ({ \
62278 uint32x4_t __ret_810; \
62279 uint32x2_t __s0_810 = __p0_810; \
62280 uint64x2_t __s1_810 = __p1_810; \
62281 uint32x2_t __rev0_810; __rev0_810 = __builtin_shufflevector(__s0_810, __s0_810, 1, 0); \
62282 uint64x2_t __rev1_810; __rev1_810 = __builtin_shufflevector(__s1_810, __s1_810, 1, 0); \
62283 __ret_810 = (uint32x4_t)(__noswap_vcombine_u32((uint32x2_t)(__rev0_810), (uint32x2_t)(__noswap_vrshrn_n_u64(__rev1_810, __p2_810)))); \
62284 __ret_810 = __builtin_shufflevector(__ret_810, __ret_810, 3, 2, 1, 0); \
62285 __ret_810; \
62286})
61740__ai poly8x16_t vuzp2q_p8(poly8x16_t __p0, poly8x16_t __p1) {
61741 poly8x16_t __ret;
61742 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61743 poly8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61744 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7, 9, 11, 13, 15, 17, 19, 21, 23, 25, 27, 29, 31);
61745 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61746 return __ret;
61747}
6228761748#endif
6228861749
6228961750#ifdef __LITTLE_ENDIAN__
62290#define vrshrn_high_n_u16(__p0_811, __p1_811, __p2_811) __extension__ ({ \
62291 uint8x16_t __ret_811; \
62292 uint8x8_t __s0_811 = __p0_811; \
62293 uint16x8_t __s1_811 = __p1_811; \
62294 __ret_811 = (uint8x16_t)(vcombine_u8((uint8x8_t)(__s0_811), (uint8x8_t)(vrshrn_n_u16(__s1_811, __p2_811)))); \
62295 __ret_811; \
62296})
61751__ai poly64x2_t vuzp2q_p64(poly64x2_t __p0, poly64x2_t __p1) {
61752 poly64x2_t __ret;
61753 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
61754 return __ret;
61755}
6229761756#else
62298#define vrshrn_high_n_u16(__p0_812, __p1_812, __p2_812) __extension__ ({ \
62299 uint8x16_t __ret_812; \
62300 uint8x8_t __s0_812 = __p0_812; \
62301 uint16x8_t __s1_812 = __p1_812; \
62302 uint8x8_t __rev0_812; __rev0_812 = __builtin_shufflevector(__s0_812, __s0_812, 7, 6, 5, 4, 3, 2, 1, 0); \
62303 uint16x8_t __rev1_812; __rev1_812 = __builtin_shufflevector(__s1_812, __s1_812, 7, 6, 5, 4, 3, 2, 1, 0); \
62304 __ret_812 = (uint8x16_t)(__noswap_vcombine_u8((uint8x8_t)(__rev0_812), (uint8x8_t)(__noswap_vrshrn_n_u16(__rev1_812, __p2_812)))); \
62305 __ret_812 = __builtin_shufflevector(__ret_812, __ret_812, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
62306 __ret_812; \
62307})
61757__ai poly64x2_t vuzp2q_p64(poly64x2_t __p0, poly64x2_t __p1) {
61758 poly64x2_t __ret;
61759 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
61760 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
61761 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
61762 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
61763 return __ret;
61764}
6230861765#endif
6230961766
6231061767#ifdef __LITTLE_ENDIAN__
62311#define vrshrn_high_n_s32(__p0_813, __p1_813, __p2_813) __extension__ ({ \
62312 int16x8_t __ret_813; \
62313 int16x4_t __s0_813 = __p0_813; \
62314 int32x4_t __s1_813 = __p1_813; \
62315 __ret_813 = (int16x8_t)(vcombine_s16((int16x4_t)(__s0_813), (int16x4_t)(vrshrn_n_s32(__s1_813, __p2_813)))); \
62316 __ret_813; \
62317})
61768__ai poly16x8_t vuzp2q_p16(poly16x8_t __p0, poly16x8_t __p1) {
61769 poly16x8_t __ret;
61770 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7, 9, 11, 13, 15);
61771 return __ret;
61772}
6231861773#else
62319#define vrshrn_high_n_s32(__p0_814, __p1_814, __p2_814) __extension__ ({ \
62320 int16x8_t __ret_814; \
62321 int16x4_t __s0_814 = __p0_814; \
62322 int32x4_t __s1_814 = __p1_814; \
62323 int16x4_t __rev0_814; __rev0_814 = __builtin_shufflevector(__s0_814, __s0_814, 3, 2, 1, 0); \
62324 int32x4_t __rev1_814; __rev1_814 = __builtin_shufflevector(__s1_814, __s1_814, 3, 2, 1, 0); \
62325 __ret_814 = (int16x8_t)(__noswap_vcombine_s16((int16x4_t)(__rev0_814), (int16x4_t)(__noswap_vrshrn_n_s32(__rev1_814, __p2_814)))); \
62326 __ret_814 = __builtin_shufflevector(__ret_814, __ret_814, 7, 6, 5, 4, 3, 2, 1, 0); \
62327 __ret_814; \
62328})
61774__ai poly16x8_t vuzp2q_p16(poly16x8_t __p0, poly16x8_t __p1) {
61775 poly16x8_t __ret;
61776 poly16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
61777 poly16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
61778 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7, 9, 11, 13, 15);
61779 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
61780 return __ret;
61781}
6232961782#endif
6233061783
6233161784#ifdef __LITTLE_ENDIAN__
62332#define vrshrn_high_n_s64(__p0_815, __p1_815, __p2_815) __extension__ ({ \
62333 int32x4_t __ret_815; \
62334 int32x2_t __s0_815 = __p0_815; \
62335 int64x2_t __s1_815 = __p1_815; \
62336 __ret_815 = (int32x4_t)(vcombine_s32((int32x2_t)(__s0_815), (int32x2_t)(vrshrn_n_s64(__s1_815, __p2_815)))); \
62337 __ret_815; \
62338})
61785__ai uint8x16_t vuzp2q_u8(uint8x16_t __p0, uint8x16_t __p1) {
61786 uint8x16_t __ret;
61787 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7, 9, 11, 13, 15, 17, 19, 21, 23, 25, 27, 29, 31);
61788 return __ret;
61789}
6233961790#else
62340#define vrshrn_high_n_s64(__p0_816, __p1_816, __p2_816) __extension__ ({ \
62341 int32x4_t __ret_816; \
62342 int32x2_t __s0_816 = __p0_816; \
62343 int64x2_t __s1_816 = __p1_816; \
62344 int32x2_t __rev0_816; __rev0_816 = __builtin_shufflevector(__s0_816, __s0_816, 1, 0); \
62345 int64x2_t __rev1_816; __rev1_816 = __builtin_shufflevector(__s1_816, __s1_816, 1, 0); \
62346 __ret_816 = (int32x4_t)(__noswap_vcombine_s32((int32x2_t)(__rev0_816), (int32x2_t)(__noswap_vrshrn_n_s64(__rev1_816, __p2_816)))); \
62347 __ret_816 = __builtin_shufflevector(__ret_816, __ret_816, 3, 2, 1, 0); \
62348 __ret_816; \
62349})
61791__ai uint8x16_t vuzp2q_u8(uint8x16_t __p0, uint8x16_t __p1) {
61792 uint8x16_t __ret;
61793 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61794 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61795 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7, 9, 11, 13, 15, 17, 19, 21, 23, 25, 27, 29, 31);
61796 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61797 return __ret;
61798}
6235061799#endif
6235161800
6235261801#ifdef __LITTLE_ENDIAN__
62353#define vrshrn_high_n_s16(__p0_817, __p1_817, __p2_817) __extension__ ({ \
62354 int8x16_t __ret_817; \
62355 int8x8_t __s0_817 = __p0_817; \
62356 int16x8_t __s1_817 = __p1_817; \
62357 __ret_817 = (int8x16_t)(vcombine_s8((int8x8_t)(__s0_817), (int8x8_t)(vrshrn_n_s16(__s1_817, __p2_817)))); \
62358 __ret_817; \
62359})
61802__ai uint32x4_t vuzp2q_u32(uint32x4_t __p0, uint32x4_t __p1) {
61803 uint32x4_t __ret;
61804 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7);
61805 return __ret;
61806}
6236061807#else
62361#define vrshrn_high_n_s16(__p0_818, __p1_818, __p2_818) __extension__ ({ \
62362 int8x16_t __ret_818; \
62363 int8x8_t __s0_818 = __p0_818; \
62364 int16x8_t __s1_818 = __p1_818; \
62365 int8x8_t __rev0_818; __rev0_818 = __builtin_shufflevector(__s0_818, __s0_818, 7, 6, 5, 4, 3, 2, 1, 0); \
62366 int16x8_t __rev1_818; __rev1_818 = __builtin_shufflevector(__s1_818, __s1_818, 7, 6, 5, 4, 3, 2, 1, 0); \
62367 __ret_818 = (int8x16_t)(__noswap_vcombine_s8((int8x8_t)(__rev0_818), (int8x8_t)(__noswap_vrshrn_n_s16(__rev1_818, __p2_818)))); \
62368 __ret_818 = __builtin_shufflevector(__ret_818, __ret_818, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
62369 __ret_818; \
62370})
61808__ai uint32x4_t vuzp2q_u32(uint32x4_t __p0, uint32x4_t __p1) {
61809 uint32x4_t __ret;
61810 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
61811 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
61812 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7);
61813 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
61814 return __ret;
61815}
6237161816#endif
6237261817
6237361818#ifdef __LITTLE_ENDIAN__
62374__ai float64x2_t vrsqrteq_f64(float64x2_t __p0) {
62375 float64x2_t __ret;
62376 __ret = (float64x2_t) __builtin_neon_vrsqrteq_v((int8x16_t)__p0, 42);
61819__ai uint64x2_t vuzp2q_u64(uint64x2_t __p0, uint64x2_t __p1) {
61820 uint64x2_t __ret;
61821 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
6237761822 return __ret;
6237861823}
6237961824#else
62380__ai float64x2_t vrsqrteq_f64(float64x2_t __p0) {
62381 float64x2_t __ret;
62382 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
62383 __ret = (float64x2_t) __builtin_neon_vrsqrteq_v((int8x16_t)__rev0, 42);
61825__ai uint64x2_t vuzp2q_u64(uint64x2_t __p0, uint64x2_t __p1) {
61826 uint64x2_t __ret;
61827 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
61828 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
61829 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
6238461830 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6238561831 return __ret;
6238661832}
6238761833#endif
6238861834
62389__ai float64x1_t vrsqrte_f64(float64x1_t __p0) {
62390 float64x1_t __ret;
62391 __ret = (float64x1_t) __builtin_neon_vrsqrte_v((int8x8_t)__p0, 10);
61835#ifdef __LITTLE_ENDIAN__
61836__ai uint16x8_t vuzp2q_u16(uint16x8_t __p0, uint16x8_t __p1) {
61837 uint16x8_t __ret;
61838 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7, 9, 11, 13, 15);
6239261839 return __ret;
6239361840}
62394__ai float64_t vrsqrted_f64(float64_t __p0) {
62395 float64_t __ret;
62396 __ret = (float64_t) __builtin_neon_vrsqrted_f64(__p0);
61841#else
61842__ai uint16x8_t vuzp2q_u16(uint16x8_t __p0, uint16x8_t __p1) {
61843 uint16x8_t __ret;
61844 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
61845 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
61846 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7, 9, 11, 13, 15);
61847 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6239761848 return __ret;
6239861849}
62399__ai float32_t vrsqrtes_f32(float32_t __p0) {
62400 float32_t __ret;
62401 __ret = (float32_t) __builtin_neon_vrsqrtes_f32(__p0);
61850#endif
61851
61852#ifdef __LITTLE_ENDIAN__
61853__ai int8x16_t vuzp2q_s8(int8x16_t __p0, int8x16_t __p1) {
61854 int8x16_t __ret;
61855 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7, 9, 11, 13, 15, 17, 19, 21, 23, 25, 27, 29, 31);
61856 return __ret;
61857}
61858#else
61859__ai int8x16_t vuzp2q_s8(int8x16_t __p0, int8x16_t __p1) {
61860 int8x16_t __ret;
61861 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61862 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61863 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7, 9, 11, 13, 15, 17, 19, 21, 23, 25, 27, 29, 31);
61864 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
6240261865 return __ret;
6240361866}
61867#endif
61868
6240461869#ifdef __LITTLE_ENDIAN__
62405__ai float64x2_t vrsqrtsq_f64(float64x2_t __p0, float64x2_t __p1) {
61870__ai float64x2_t vuzp2q_f64(float64x2_t __p0, float64x2_t __p1) {
6240661871 float64x2_t __ret;
62407 __ret = (float64x2_t) __builtin_neon_vrsqrtsq_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
61872 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
6240861873 return __ret;
6240961874}
6241061875#else
62411__ai float64x2_t vrsqrtsq_f64(float64x2_t __p0, float64x2_t __p1) {
61876__ai float64x2_t vuzp2q_f64(float64x2_t __p0, float64x2_t __p1) {
6241261877 float64x2_t __ret;
6241361878 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
6241461879 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
62415 __ret = (float64x2_t) __builtin_neon_vrsqrtsq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
61880 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
6241661881 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6241761882 return __ret;
6241861883}
6241961884#endif
6242061885
62421__ai float64x1_t vrsqrts_f64(float64x1_t __p0, float64x1_t __p1) {
62422 float64x1_t __ret;
62423 __ret = (float64x1_t) __builtin_neon_vrsqrts_v((int8x8_t)__p0, (int8x8_t)__p1, 10);
62424 return __ret;
62425}
62426__ai float64_t vrsqrtsd_f64(float64_t __p0, float64_t __p1) {
62427 float64_t __ret;
62428 __ret = (float64_t) __builtin_neon_vrsqrtsd_f64(__p0, __p1);
62429 return __ret;
62430}
62431__ai float32_t vrsqrtss_f32(float32_t __p0, float32_t __p1) {
62432 float32_t __ret;
62433 __ret = (float32_t) __builtin_neon_vrsqrtss_f32(__p0, __p1);
62434 return __ret;
62435}
62436#define vrsrad_n_u64(__p0, __p1, __p2) __extension__ ({ \
62437 uint64_t __ret; \
62438 uint64_t __s0 = __p0; \
62439 uint64_t __s1 = __p1; \
62440 __ret = (uint64_t) __builtin_neon_vrsrad_n_u64(__s0, __s1, __p2); \
62441 __ret; \
62442})
62443#define vrsrad_n_s64(__p0, __p1, __p2) __extension__ ({ \
62444 int64_t __ret; \
62445 int64_t __s0 = __p0; \
62446 int64_t __s1 = __p1; \
62447 __ret = (int64_t) __builtin_neon_vrsrad_n_s64(__s0, __s1, __p2); \
62448 __ret; \
62449})
6245061886#ifdef __LITTLE_ENDIAN__
62451__ai uint16x8_t vrsubhn_high_u32(uint16x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
62452 uint16x8_t __ret;
62453 __ret = vcombine_u16(__p0, vrsubhn_u32(__p1, __p2));
61887__ai float32x4_t vuzp2q_f32(float32x4_t __p0, float32x4_t __p1) {
61888 float32x4_t __ret;
61889 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7);
6245461890 return __ret;
6245561891}
6245661892#else
62457__ai uint16x8_t vrsubhn_high_u32(uint16x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
62458 uint16x8_t __ret;
62459 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
62460 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
62461 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
62462 __ret = __noswap_vcombine_u16(__rev0, __noswap_vrsubhn_u32(__rev1, __rev2));
62463 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
61893__ai float32x4_t vuzp2q_f32(float32x4_t __p0, float32x4_t __p1) {
61894 float32x4_t __ret;
61895 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
61896 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
61897 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7);
61898 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6246461899 return __ret;
6246561900}
6246661901#endif
6246761902
6246861903#ifdef __LITTLE_ENDIAN__
62469__ai uint32x4_t vrsubhn_high_u64(uint32x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
62470 uint32x4_t __ret;
62471 __ret = vcombine_u32(__p0, vrsubhn_u64(__p1, __p2));
61904__ai int32x4_t vuzp2q_s32(int32x4_t __p0, int32x4_t __p1) {
61905 int32x4_t __ret;
61906 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7);
6247261907 return __ret;
6247361908}
6247461909#else
62475__ai uint32x4_t vrsubhn_high_u64(uint32x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
62476 uint32x4_t __ret;
62477 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
62478 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
62479 uint64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
62480 __ret = __noswap_vcombine_u32(__rev0, __noswap_vrsubhn_u64(__rev1, __rev2));
61910__ai int32x4_t vuzp2q_s32(int32x4_t __p0, int32x4_t __p1) {
61911 int32x4_t __ret;
61912 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
61913 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
61914 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7);
6248161915 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6248261916 return __ret;
6248361917}
6248461918#endif
6248561919
6248661920#ifdef __LITTLE_ENDIAN__
62487__ai uint8x16_t vrsubhn_high_u16(uint8x8_t __p0, uint16x8_t __p1, uint16x8_t __p2) {
62488 uint8x16_t __ret;
62489 __ret = vcombine_u8(__p0, vrsubhn_u16(__p1, __p2));
61921__ai int64x2_t vuzp2q_s64(int64x2_t __p0, int64x2_t __p1) {
61922 int64x2_t __ret;
61923 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
6249061924 return __ret;
6249161925}
6249261926#else
62493__ai uint8x16_t vrsubhn_high_u16(uint8x8_t __p0, uint16x8_t __p1, uint16x8_t __p2) {
62494 uint8x16_t __ret;
62495 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
62496 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
62497 uint16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
62498 __ret = __noswap_vcombine_u8(__rev0, __noswap_vrsubhn_u16(__rev1, __rev2));
62499 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61927__ai int64x2_t vuzp2q_s64(int64x2_t __p0, int64x2_t __p1) {
61928 int64x2_t __ret;
61929 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
61930 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
61931 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
61932 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6250061933 return __ret;
6250161934}
6250261935#endif
6250361936
6250461937#ifdef __LITTLE_ENDIAN__
62505__ai int16x8_t vrsubhn_high_s32(int16x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
61938__ai int16x8_t vuzp2q_s16(int16x8_t __p0, int16x8_t __p1) {
6250661939 int16x8_t __ret;
62507 __ret = vcombine_s16(__p0, vrsubhn_s32(__p1, __p2));
61940 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7, 9, 11, 13, 15);
6250861941 return __ret;
6250961942}
6251061943#else
62511__ai int16x8_t vrsubhn_high_s32(int16x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
61944__ai int16x8_t vuzp2q_s16(int16x8_t __p0, int16x8_t __p1) {
6251261945 int16x8_t __ret;
62513 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
62514 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
62515 int32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
62516 __ret = __noswap_vcombine_s16(__rev0, __noswap_vrsubhn_s32(__rev1, __rev2));
61946 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
61947 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
61948 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7, 9, 11, 13, 15);
6251761949 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6251861950 return __ret;
6251961951}
6252061952#endif
6252161953
6252261954#ifdef __LITTLE_ENDIAN__
62523__ai int32x4_t vrsubhn_high_s64(int32x2_t __p0, int64x2_t __p1, int64x2_t __p2) {
62524 int32x4_t __ret;
62525 __ret = vcombine_s32(__p0, vrsubhn_s64(__p1, __p2));
61955__ai uint8x8_t vuzp2_u8(uint8x8_t __p0, uint8x8_t __p1) {
61956 uint8x8_t __ret;
61957 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7, 9, 11, 13, 15);
6252661958 return __ret;
6252761959}
6252861960#else
62529__ai int32x4_t vrsubhn_high_s64(int32x2_t __p0, int64x2_t __p1, int64x2_t __p2) {
62530 int32x4_t __ret;
62531 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
62532 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
62533 int64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
62534 __ret = __noswap_vcombine_s32(__rev0, __noswap_vrsubhn_s64(__rev1, __rev2));
62535 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
61961__ai uint8x8_t vuzp2_u8(uint8x8_t __p0, uint8x8_t __p1) {
61962 uint8x8_t __ret;
61963 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
61964 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
61965 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7, 9, 11, 13, 15);
61966 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6253661967 return __ret;
6253761968}
6253861969#endif
6253961970
6254061971#ifdef __LITTLE_ENDIAN__
62541__ai int8x16_t vrsubhn_high_s16(int8x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
62542 int8x16_t __ret;
62543 __ret = vcombine_s8(__p0, vrsubhn_s16(__p1, __p2));
61972__ai uint32x2_t vuzp2_u32(uint32x2_t __p0, uint32x2_t __p1) {
61973 uint32x2_t __ret;
61974 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
6254461975 return __ret;
6254561976}
6254661977#else
62547__ai int8x16_t vrsubhn_high_s16(int8x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
62548 int8x16_t __ret;
62549 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
62550 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
62551 int16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
62552 __ret = __noswap_vcombine_s8(__rev0, __noswap_vrsubhn_s16(__rev1, __rev2));
62553 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
61978__ai uint32x2_t vuzp2_u32(uint32x2_t __p0, uint32x2_t __p1) {
61979 uint32x2_t __ret;
61980 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
61981 uint32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
61982 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
61983 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6255461984 return __ret;
6255561985}
6255661986#endif
6255761987
62558#define vset_lane_p64(__p0, __p1, __p2) __extension__ ({ \
62559 poly64x1_t __ret; \
62560 poly64_t __s0 = __p0; \
62561 poly64x1_t __s1 = __p1; \
62562 __ret = (poly64x1_t) __builtin_neon_vset_lane_i64(__s0, (poly64x1_t)__s1, __p2); \
62563 __ret; \
62564})
6256561988#ifdef __LITTLE_ENDIAN__
62566#define vsetq_lane_p64(__p0, __p1, __p2) __extension__ ({ \
62567 poly64x2_t __ret; \
62568 poly64_t __s0 = __p0; \
62569 poly64x2_t __s1 = __p1; \
62570 __ret = (poly64x2_t) __builtin_neon_vsetq_lane_i64(__s0, (poly64x2_t)__s1, __p2); \
62571 __ret; \
62572})
61989__ai uint16x4_t vuzp2_u16(uint16x4_t __p0, uint16x4_t __p1) {
61990 uint16x4_t __ret;
61991 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7);
61992 return __ret;
61993}
6257361994#else
62574#define vsetq_lane_p64(__p0, __p1, __p2) __extension__ ({ \
62575 poly64x2_t __ret; \
62576 poly64_t __s0 = __p0; \
62577 poly64x2_t __s1 = __p1; \
62578 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
62579 __ret = (poly64x2_t) __builtin_neon_vsetq_lane_i64(__s0, (poly64x2_t)__rev1, __p2); \
62580 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
62581 __ret; \
62582})
62583#define __noswap_vsetq_lane_p64(__p0, __p1, __p2) __extension__ ({ \
62584 poly64x2_t __ret; \
62585 poly64_t __s0 = __p0; \
62586 poly64x2_t __s1 = __p1; \
62587 __ret = (poly64x2_t) __builtin_neon_vsetq_lane_i64(__s0, (poly64x2_t)__s1, __p2); \
62588 __ret; \
62589})
61995__ai uint16x4_t vuzp2_u16(uint16x4_t __p0, uint16x4_t __p1) {
61996 uint16x4_t __ret;
61997 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
61998 uint16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
61999 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7);
62000 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
62001 return __ret;
62002}
6259062003#endif
6259162004
6259262005#ifdef __LITTLE_ENDIAN__
62593#define vsetq_lane_f64(__p0, __p1, __p2) __extension__ ({ \
62594 float64x2_t __ret; \
62595 float64_t __s0 = __p0; \
62596 float64x2_t __s1 = __p1; \
62597 __ret = (float64x2_t) __builtin_neon_vsetq_lane_f64(__s0, (float64x2_t)__s1, __p2); \
62598 __ret; \
62599})
62600#else
62601#define vsetq_lane_f64(__p0, __p1, __p2) __extension__ ({ \
62602 float64x2_t __ret; \
62603 float64_t __s0 = __p0; \
62604 float64x2_t __s1 = __p1; \
62605 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
62606 __ret = (float64x2_t) __builtin_neon_vsetq_lane_f64(__s0, (float64x2_t)__rev1, __p2); \
62607 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
62608 __ret; \
62609})
62610#define __noswap_vsetq_lane_f64(__p0, __p1, __p2) __extension__ ({ \
62611 float64x2_t __ret; \
62612 float64_t __s0 = __p0; \
62613 float64x2_t __s1 = __p1; \
62614 __ret = (float64x2_t) __builtin_neon_vsetq_lane_f64(__s0, (float64x2_t)__s1, __p2); \
62615 __ret; \
62616})
62617#endif
62618
62619#define vset_lane_f64(__p0, __p1, __p2) __extension__ ({ \
62620 float64x1_t __ret; \
62621 float64_t __s0 = __p0; \
62622 float64x1_t __s1 = __p1; \
62623 __ret = (float64x1_t) __builtin_neon_vset_lane_f64(__s0, (float64x1_t)__s1, __p2); \
62624 __ret; \
62625})
62626__ai uint64_t vshld_u64(uint64_t __p0, int64_t __p1) {
62627 uint64_t __ret;
62628 __ret = (uint64_t) __builtin_neon_vshld_u64(__p0, __p1);
62006__ai int8x8_t vuzp2_s8(int8x8_t __p0, int8x8_t __p1) {
62007 int8x8_t __ret;
62008 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7, 9, 11, 13, 15);
6262962009 return __ret;
6263062010}
62631__ai int64_t vshld_s64(int64_t __p0, int64_t __p1) {
62632 int64_t __ret;
62633 __ret = (int64_t) __builtin_neon_vshld_s64(__p0, __p1);
62011#else
62012__ai int8x8_t vuzp2_s8(int8x8_t __p0, int8x8_t __p1) {
62013 int8x8_t __ret;
62014 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
62015 int8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
62016 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7, 9, 11, 13, 15);
62017 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6263462018 return __ret;
6263562019}
62636#define vshld_n_u64(__p0, __p1) __extension__ ({ \
62637 uint64_t __ret; \
62638 uint64_t __s0 = __p0; \
62639 __ret = (uint64_t) __builtin_neon_vshld_n_u64(__s0, __p1); \
62640 __ret; \
62641})
62642#define vshld_n_s64(__p0, __p1) __extension__ ({ \
62643 int64_t __ret; \
62644 int64_t __s0 = __p0; \
62645 __ret = (int64_t) __builtin_neon_vshld_n_s64(__s0, __p1); \
62646 __ret; \
62647})
62648#ifdef __LITTLE_ENDIAN__
62649#define vshll_high_n_u8(__p0_819, __p1_819) __extension__ ({ \
62650 uint16x8_t __ret_819; \
62651 uint8x16_t __s0_819 = __p0_819; \
62652 __ret_819 = (uint16x8_t)(vshll_n_u8(vget_high_u8(__s0_819), __p1_819)); \
62653 __ret_819; \
62654})
62655#else
62656#define vshll_high_n_u8(__p0_820, __p1_820) __extension__ ({ \
62657 uint16x8_t __ret_820; \
62658 uint8x16_t __s0_820 = __p0_820; \
62659 uint8x16_t __rev0_820; __rev0_820 = __builtin_shufflevector(__s0_820, __s0_820, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
62660 __ret_820 = (uint16x8_t)(__noswap_vshll_n_u8(__noswap_vget_high_u8(__rev0_820), __p1_820)); \
62661 __ret_820 = __builtin_shufflevector(__ret_820, __ret_820, 7, 6, 5, 4, 3, 2, 1, 0); \
62662 __ret_820; \
62663})
6266462020#endif
6266562021
6266662022#ifdef __LITTLE_ENDIAN__
62667#define vshll_high_n_u32(__p0_821, __p1_821) __extension__ ({ \
62668 uint64x2_t __ret_821; \
62669 uint32x4_t __s0_821 = __p0_821; \
62670 __ret_821 = (uint64x2_t)(vshll_n_u32(vget_high_u32(__s0_821), __p1_821)); \
62671 __ret_821; \
62672})
62023__ai float32x2_t vuzp2_f32(float32x2_t __p0, float32x2_t __p1) {
62024 float32x2_t __ret;
62025 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
62026 return __ret;
62027}
6267362028#else
62674#define vshll_high_n_u32(__p0_822, __p1_822) __extension__ ({ \
62675 uint64x2_t __ret_822; \
62676 uint32x4_t __s0_822 = __p0_822; \
62677 uint32x4_t __rev0_822; __rev0_822 = __builtin_shufflevector(__s0_822, __s0_822, 3, 2, 1, 0); \
62678 __ret_822 = (uint64x2_t)(__noswap_vshll_n_u32(__noswap_vget_high_u32(__rev0_822), __p1_822)); \
62679 __ret_822 = __builtin_shufflevector(__ret_822, __ret_822, 1, 0); \
62680 __ret_822; \
62681})
62029__ai float32x2_t vuzp2_f32(float32x2_t __p0, float32x2_t __p1) {
62030 float32x2_t __ret;
62031 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
62032 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
62033 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
62034 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
62035 return __ret;
62036}
6268262037#endif
6268362038
6268462039#ifdef __LITTLE_ENDIAN__
62685#define vshll_high_n_u16(__p0_823, __p1_823) __extension__ ({ \
62686 uint32x4_t __ret_823; \
62687 uint16x8_t __s0_823 = __p0_823; \
62688 __ret_823 = (uint32x4_t)(vshll_n_u16(vget_high_u16(__s0_823), __p1_823)); \
62689 __ret_823; \
62690})
62040__ai int32x2_t vuzp2_s32(int32x2_t __p0, int32x2_t __p1) {
62041 int32x2_t __ret;
62042 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
62043 return __ret;
62044}
6269162045#else
62692#define vshll_high_n_u16(__p0_824, __p1_824) __extension__ ({ \
62693 uint32x4_t __ret_824; \
62694 uint16x8_t __s0_824 = __p0_824; \
62695 uint16x8_t __rev0_824; __rev0_824 = __builtin_shufflevector(__s0_824, __s0_824, 7, 6, 5, 4, 3, 2, 1, 0); \
62696 __ret_824 = (uint32x4_t)(__noswap_vshll_n_u16(__noswap_vget_high_u16(__rev0_824), __p1_824)); \
62697 __ret_824 = __builtin_shufflevector(__ret_824, __ret_824, 3, 2, 1, 0); \
62698 __ret_824; \
62699})
62046__ai int32x2_t vuzp2_s32(int32x2_t __p0, int32x2_t __p1) {
62047 int32x2_t __ret;
62048 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
62049 int32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
62050 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
62051 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
62052 return __ret;
62053}
6270062054#endif
6270162055
6270262056#ifdef __LITTLE_ENDIAN__
62703#define vshll_high_n_s8(__p0_825, __p1_825) __extension__ ({ \
62704 int16x8_t __ret_825; \
62705 int8x16_t __s0_825 = __p0_825; \
62706 __ret_825 = (int16x8_t)(vshll_n_s8(vget_high_s8(__s0_825), __p1_825)); \
62707 __ret_825; \
62708})
62057__ai int16x4_t vuzp2_s16(int16x4_t __p0, int16x4_t __p1) {
62058 int16x4_t __ret;
62059 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7);
62060 return __ret;
62061}
6270962062#else
62710#define vshll_high_n_s8(__p0_826, __p1_826) __extension__ ({ \
62711 int16x8_t __ret_826; \
62712 int8x16_t __s0_826 = __p0_826; \
62713 int8x16_t __rev0_826; __rev0_826 = __builtin_shufflevector(__s0_826, __s0_826, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
62714 __ret_826 = (int16x8_t)(__noswap_vshll_n_s8(__noswap_vget_high_s8(__rev0_826), __p1_826)); \
62715 __ret_826 = __builtin_shufflevector(__ret_826, __ret_826, 7, 6, 5, 4, 3, 2, 1, 0); \
62716 __ret_826; \
62717})
62063__ai int16x4_t vuzp2_s16(int16x4_t __p0, int16x4_t __p1) {
62064 int16x4_t __ret;
62065 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
62066 int16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
62067 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7);
62068 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
62069 return __ret;
62070}
6271862071#endif
6271962072
6272062073#ifdef __LITTLE_ENDIAN__
62721#define vshll_high_n_s32(__p0_827, __p1_827) __extension__ ({ \
62722 int64x2_t __ret_827; \
62723 int32x4_t __s0_827 = __p0_827; \
62724 __ret_827 = (int64x2_t)(vshll_n_s32(vget_high_s32(__s0_827), __p1_827)); \
62725 __ret_827; \
62726})
62074__ai poly8x8_t vzip1_p8(poly8x8_t __p0, poly8x8_t __p1) {
62075 poly8x8_t __ret;
62076 __ret = __builtin_shufflevector(__p0, __p1, 0, 8, 1, 9, 2, 10, 3, 11);
62077 return __ret;
62078}
6272762079#else
62728#define vshll_high_n_s32(__p0_828, __p1_828) __extension__ ({ \
62729 int64x2_t __ret_828; \
62730 int32x4_t __s0_828 = __p0_828; \
62731 int32x4_t __rev0_828; __rev0_828 = __builtin_shufflevector(__s0_828, __s0_828, 3, 2, 1, 0); \
62732 __ret_828 = (int64x2_t)(__noswap_vshll_n_s32(__noswap_vget_high_s32(__rev0_828), __p1_828)); \
62733 __ret_828 = __builtin_shufflevector(__ret_828, __ret_828, 1, 0); \
62734 __ret_828; \
62735})
62080__ai poly8x8_t vzip1_p8(poly8x8_t __p0, poly8x8_t __p1) {
62081 poly8x8_t __ret;
62082 poly8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
62083 poly8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
62084 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 8, 1, 9, 2, 10, 3, 11);
62085 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
62086 return __ret;
62087}
6273662088#endif
6273762089
6273862090#ifdef __LITTLE_ENDIAN__
62739#define vshll_high_n_s16(__p0_829, __p1_829) __extension__ ({ \
62740 int32x4_t __ret_829; \
62741 int16x8_t __s0_829 = __p0_829; \
62742 __ret_829 = (int32x4_t)(vshll_n_s16(vget_high_s16(__s0_829), __p1_829)); \
62743 __ret_829; \
62744})
62091__ai poly16x4_t vzip1_p16(poly16x4_t __p0, poly16x4_t __p1) {
62092 poly16x4_t __ret;
62093 __ret = __builtin_shufflevector(__p0, __p1, 0, 4, 1, 5);
62094 return __ret;
62095}
6274562096#else
62746#define vshll_high_n_s16(__p0_830, __p1_830) __extension__ ({ \
62747 int32x4_t __ret_830; \
62748 int16x8_t __s0_830 = __p0_830; \
62749 int16x8_t __rev0_830; __rev0_830 = __builtin_shufflevector(__s0_830, __s0_830, 7, 6, 5, 4, 3, 2, 1, 0); \
62750 __ret_830 = (int32x4_t)(__noswap_vshll_n_s16(__noswap_vget_high_s16(__rev0_830), __p1_830)); \
62751 __ret_830 = __builtin_shufflevector(__ret_830, __ret_830, 3, 2, 1, 0); \
62752 __ret_830; \
62753})
62097__ai poly16x4_t vzip1_p16(poly16x4_t __p0, poly16x4_t __p1) {
62098 poly16x4_t __ret;
62099 poly16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
62100 poly16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
62101 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 4, 1, 5);
62102 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
62103 return __ret;
62104}
6275462105#endif
6275562106
62756#define vshrd_n_u64(__p0, __p1) __extension__ ({ \
62757 uint64_t __ret; \
62758 uint64_t __s0 = __p0; \
62759 __ret = (uint64_t) __builtin_neon_vshrd_n_u64(__s0, __p1); \
62760 __ret; \
62761})
62762#define vshrd_n_s64(__p0, __p1) __extension__ ({ \
62763 int64_t __ret; \
62764 int64_t __s0 = __p0; \
62765 __ret = (int64_t) __builtin_neon_vshrd_n_s64(__s0, __p1); \
62766 __ret; \
62767})
6276862107#ifdef __LITTLE_ENDIAN__
62769#define vshrn_high_n_u32(__p0_831, __p1_831, __p2_831) __extension__ ({ \
62770 uint16x8_t __ret_831; \
62771 uint16x4_t __s0_831 = __p0_831; \
62772 uint32x4_t __s1_831 = __p1_831; \
62773 __ret_831 = (uint16x8_t)(vcombine_u16((uint16x4_t)(__s0_831), (uint16x4_t)(vshrn_n_u32(__s1_831, __p2_831)))); \
62774 __ret_831; \
62775})
62108__ai poly8x16_t vzip1q_p8(poly8x16_t __p0, poly8x16_t __p1) {
62109 poly8x16_t __ret;
62110 __ret = __builtin_shufflevector(__p0, __p1, 0, 16, 1, 17, 2, 18, 3, 19, 4, 20, 5, 21, 6, 22, 7, 23);
62111 return __ret;
62112}
6277662113#else
62777#define vshrn_high_n_u32(__p0_832, __p1_832, __p2_832) __extension__ ({ \
62778 uint16x8_t __ret_832; \
62779 uint16x4_t __s0_832 = __p0_832; \
62780 uint32x4_t __s1_832 = __p1_832; \
62781 uint16x4_t __rev0_832; __rev0_832 = __builtin_shufflevector(__s0_832, __s0_832, 3, 2, 1, 0); \
62782 uint32x4_t __rev1_832; __rev1_832 = __builtin_shufflevector(__s1_832, __s1_832, 3, 2, 1, 0); \
62783 __ret_832 = (uint16x8_t)(__noswap_vcombine_u16((uint16x4_t)(__rev0_832), (uint16x4_t)(__noswap_vshrn_n_u32(__rev1_832, __p2_832)))); \
62784 __ret_832 = __builtin_shufflevector(__ret_832, __ret_832, 7, 6, 5, 4, 3, 2, 1, 0); \
62785 __ret_832; \
62786})
62114__ai poly8x16_t vzip1q_p8(poly8x16_t __p0, poly8x16_t __p1) {
62115 poly8x16_t __ret;
62116 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
62117 poly8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
62118 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 16, 1, 17, 2, 18, 3, 19, 4, 20, 5, 21, 6, 22, 7, 23);
62119 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
62120 return __ret;
62121}
6278762122#endif
6278862123
6278962124#ifdef __LITTLE_ENDIAN__
62790#define vshrn_high_n_u64(__p0_833, __p1_833, __p2_833) __extension__ ({ \
62791 uint32x4_t __ret_833; \
62792 uint32x2_t __s0_833 = __p0_833; \
62793 uint64x2_t __s1_833 = __p1_833; \
62794 __ret_833 = (uint32x4_t)(vcombine_u32((uint32x2_t)(__s0_833), (uint32x2_t)(vshrn_n_u64(__s1_833, __p2_833)))); \
62795 __ret_833; \
62796})
62125__ai poly64x2_t vzip1q_p64(poly64x2_t __p0, poly64x2_t __p1) {
62126 poly64x2_t __ret;
62127 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
62128 return __ret;
62129}
6279762130#else
62798#define vshrn_high_n_u64(__p0_834, __p1_834, __p2_834) __extension__ ({ \
62799 uint32x4_t __ret_834; \
62800 uint32x2_t __s0_834 = __p0_834; \
62801 uint64x2_t __s1_834 = __p1_834; \
62802 uint32x2_t __rev0_834; __rev0_834 = __builtin_shufflevector(__s0_834, __s0_834, 1, 0); \
62803 uint64x2_t __rev1_834; __rev1_834 = __builtin_shufflevector(__s1_834, __s1_834, 1, 0); \
62804 __ret_834 = (uint32x4_t)(__noswap_vcombine_u32((uint32x2_t)(__rev0_834), (uint32x2_t)(__noswap_vshrn_n_u64(__rev1_834, __p2_834)))); \
62805 __ret_834 = __builtin_shufflevector(__ret_834, __ret_834, 3, 2, 1, 0); \
62806 __ret_834; \
62807})
62131__ai poly64x2_t vzip1q_p64(poly64x2_t __p0, poly64x2_t __p1) {
62132 poly64x2_t __ret;
62133 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
62134 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
62135 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
62136 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
62137 return __ret;
62138}
6280862139#endif
6280962140
6281062141#ifdef __LITTLE_ENDIAN__
62811#define vshrn_high_n_u16(__p0_835, __p1_835, __p2_835) __extension__ ({ \
62812 uint8x16_t __ret_835; \
62813 uint8x8_t __s0_835 = __p0_835; \
62814 uint16x8_t __s1_835 = __p1_835; \
62815 __ret_835 = (uint8x16_t)(vcombine_u8((uint8x8_t)(__s0_835), (uint8x8_t)(vshrn_n_u16(__s1_835, __p2_835)))); \
62816 __ret_835; \
62817})
62142__ai poly16x8_t vzip1q_p16(poly16x8_t __p0, poly16x8_t __p1) {
62143 poly16x8_t __ret;
62144 __ret = __builtin_shufflevector(__p0, __p1, 0, 8, 1, 9, 2, 10, 3, 11);
62145 return __ret;
62146}
6281862147#else
62819#define vshrn_high_n_u16(__p0_836, __p1_836, __p2_836) __extension__ ({ \
62820 uint8x16_t __ret_836; \
62821 uint8x8_t __s0_836 = __p0_836; \
62822 uint16x8_t __s1_836 = __p1_836; \
62823 uint8x8_t __rev0_836; __rev0_836 = __builtin_shufflevector(__s0_836, __s0_836, 7, 6, 5, 4, 3, 2, 1, 0); \
62824 uint16x8_t __rev1_836; __rev1_836 = __builtin_shufflevector(__s1_836, __s1_836, 7, 6, 5, 4, 3, 2, 1, 0); \
62825 __ret_836 = (uint8x16_t)(__noswap_vcombine_u8((uint8x8_t)(__rev0_836), (uint8x8_t)(__noswap_vshrn_n_u16(__rev1_836, __p2_836)))); \
62826 __ret_836 = __builtin_shufflevector(__ret_836, __ret_836, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
62827 __ret_836; \
62828})
62148__ai poly16x8_t vzip1q_p16(poly16x8_t __p0, poly16x8_t __p1) {
62149 poly16x8_t __ret;
62150 poly16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
62151 poly16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
62152 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 8, 1, 9, 2, 10, 3, 11);
62153 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
62154 return __ret;
62155}
6282962156#endif
6283062157
6283162158#ifdef __LITTLE_ENDIAN__
62832#define vshrn_high_n_s32(__p0_837, __p1_837, __p2_837) __extension__ ({ \
62833 int16x8_t __ret_837; \
62834 int16x4_t __s0_837 = __p0_837; \
62835 int32x4_t __s1_837 = __p1_837; \
62836 __ret_837 = (int16x8_t)(vcombine_s16((int16x4_t)(__s0_837), (int16x4_t)(vshrn_n_s32(__s1_837, __p2_837)))); \
62837 __ret_837; \
62838})
62159__ai uint8x16_t vzip1q_u8(uint8x16_t __p0, uint8x16_t __p1) {
62160 uint8x16_t __ret;
62161 __ret = __builtin_shufflevector(__p0, __p1, 0, 16, 1, 17, 2, 18, 3, 19, 4, 20, 5, 21, 6, 22, 7, 23);
62162 return __ret;
62163}
6283962164#else
62840#define vshrn_high_n_s32(__p0_838, __p1_838, __p2_838) __extension__ ({ \
62841 int16x8_t __ret_838; \
62842 int16x4_t __s0_838 = __p0_838; \
62843 int32x4_t __s1_838 = __p1_838; \
62844 int16x4_t __rev0_838; __rev0_838 = __builtin_shufflevector(__s0_838, __s0_838, 3, 2, 1, 0); \
62845 int32x4_t __rev1_838; __rev1_838 = __builtin_shufflevector(__s1_838, __s1_838, 3, 2, 1, 0); \
62846 __ret_838 = (int16x8_t)(__noswap_vcombine_s16((int16x4_t)(__rev0_838), (int16x4_t)(__noswap_vshrn_n_s32(__rev1_838, __p2_838)))); \
62847 __ret_838 = __builtin_shufflevector(__ret_838, __ret_838, 7, 6, 5, 4, 3, 2, 1, 0); \
62848 __ret_838; \
62849})
62165__ai uint8x16_t vzip1q_u8(uint8x16_t __p0, uint8x16_t __p1) {
62166 uint8x16_t __ret;
62167 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
62168 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
62169 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 16, 1, 17, 2, 18, 3, 19, 4, 20, 5, 21, 6, 22, 7, 23);
62170 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
62171 return __ret;
62172}
6285062173#endif
6285162174
6285262175#ifdef __LITTLE_ENDIAN__
62853#define vshrn_high_n_s64(__p0_839, __p1_839, __p2_839) __extension__ ({ \
62854 int32x4_t __ret_839; \
62855 int32x2_t __s0_839 = __p0_839; \
62856 int64x2_t __s1_839 = __p1_839; \
62857 __ret_839 = (int32x4_t)(vcombine_s32((int32x2_t)(__s0_839), (int32x2_t)(vshrn_n_s64(__s1_839, __p2_839)))); \
62858 __ret_839; \
62859})
62176__ai uint32x4_t vzip1q_u32(uint32x4_t __p0, uint32x4_t __p1) {
62177 uint32x4_t __ret;
62178 __ret = __builtin_shufflevector(__p0, __p1, 0, 4, 1, 5);
62179 return __ret;
62180}
6286062181#else
62861#define vshrn_high_n_s64(__p0_840, __p1_840, __p2_840) __extension__ ({ \
62862 int32x4_t __ret_840; \
62863 int32x2_t __s0_840 = __p0_840; \
62864 int64x2_t __s1_840 = __p1_840; \
62865 int32x2_t __rev0_840; __rev0_840 = __builtin_shufflevector(__s0_840, __s0_840, 1, 0); \
62866 int64x2_t __rev1_840; __rev1_840 = __builtin_shufflevector(__s1_840, __s1_840, 1, 0); \
62867 __ret_840 = (int32x4_t)(__noswap_vcombine_s32((int32x2_t)(__rev0_840), (int32x2_t)(__noswap_vshrn_n_s64(__rev1_840, __p2_840)))); \
62868 __ret_840 = __builtin_shufflevector(__ret_840, __ret_840, 3, 2, 1, 0); \
62869 __ret_840; \
62870})
62182__ai uint32x4_t vzip1q_u32(uint32x4_t __p0, uint32x4_t __p1) {
62183 uint32x4_t __ret;
62184 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
62185 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
62186 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 4, 1, 5);
62187 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
62188 return __ret;
62189}
6287162190#endif
6287262191
6287362192#ifdef __LITTLE_ENDIAN__
62874#define vshrn_high_n_s16(__p0_841, __p1_841, __p2_841) __extension__ ({ \
62875 int8x16_t __ret_841; \
62876 int8x8_t __s0_841 = __p0_841; \
62877 int16x8_t __s1_841 = __p1_841; \
62878 __ret_841 = (int8x16_t)(vcombine_s8((int8x8_t)(__s0_841), (int8x8_t)(vshrn_n_s16(__s1_841, __p2_841)))); \
62879 __ret_841; \
62880})
62193__ai uint64x2_t vzip1q_u64(uint64x2_t __p0, uint64x2_t __p1) {
62194 uint64x2_t __ret;
62195 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
62196 return __ret;
62197}
6288162198#else
62882#define vshrn_high_n_s16(__p0_842, __p1_842, __p2_842) __extension__ ({ \
62883 int8x16_t __ret_842; \
62884 int8x8_t __s0_842 = __p0_842; \
62885 int16x8_t __s1_842 = __p1_842; \
62886 int8x8_t __rev0_842; __rev0_842 = __builtin_shufflevector(__s0_842, __s0_842, 7, 6, 5, 4, 3, 2, 1, 0); \
62887 int16x8_t __rev1_842; __rev1_842 = __builtin_shufflevector(__s1_842, __s1_842, 7, 6, 5, 4, 3, 2, 1, 0); \
62888 __ret_842 = (int8x16_t)(__noswap_vcombine_s8((int8x8_t)(__rev0_842), (int8x8_t)(__noswap_vshrn_n_s16(__rev1_842, __p2_842)))); \
62889 __ret_842 = __builtin_shufflevector(__ret_842, __ret_842, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
62890 __ret_842; \
62891})
62199__ai uint64x2_t vzip1q_u64(uint64x2_t __p0, uint64x2_t __p1) {
62200 uint64x2_t __ret;
62201 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
62202 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
62203 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
62204 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
62205 return __ret;
62206}
6289262207#endif
6289362208
62894#define vslid_n_u64(__p0, __p1, __p2) __extension__ ({ \
62895 uint64_t __ret; \
62896 uint64_t __s0 = __p0; \
62897 uint64_t __s1 = __p1; \
62898 __ret = (uint64_t) __builtin_neon_vslid_n_u64(__s0, __s1, __p2); \
62899 __ret; \
62900})
62901#define vslid_n_s64(__p0, __p1, __p2) __extension__ ({ \
62902 int64_t __ret; \
62903 int64_t __s0 = __p0; \
62904 int64_t __s1 = __p1; \
62905 __ret = (int64_t) __builtin_neon_vslid_n_s64(__s0, __s1, __p2); \
62906 __ret; \
62907})
62908#define vsli_n_p64(__p0, __p1, __p2) __extension__ ({ \
62909 poly64x1_t __ret; \
62910 poly64x1_t __s0 = __p0; \
62911 poly64x1_t __s1 = __p1; \
62912 __ret = (poly64x1_t) __builtin_neon_vsli_n_v((int8x8_t)__s0, (int8x8_t)__s1, __p2, 6); \
62913 __ret; \
62914})
6291562209#ifdef __LITTLE_ENDIAN__
62916#define vsliq_n_p64(__p0, __p1, __p2) __extension__ ({ \
62917 poly64x2_t __ret; \
62918 poly64x2_t __s0 = __p0; \
62919 poly64x2_t __s1 = __p1; \
62920 __ret = (poly64x2_t) __builtin_neon_vsliq_n_v((int8x16_t)__s0, (int8x16_t)__s1, __p2, 38); \
62921 __ret; \
62922})
62210__ai uint16x8_t vzip1q_u16(uint16x8_t __p0, uint16x8_t __p1) {
62211 uint16x8_t __ret;
62212 __ret = __builtin_shufflevector(__p0, __p1, 0, 8, 1, 9, 2, 10, 3, 11);
62213 return __ret;
62214}
6292362215#else
62924#define vsliq_n_p64(__p0, __p1, __p2) __extension__ ({ \
62925 poly64x2_t __ret; \
62926 poly64x2_t __s0 = __p0; \
62927 poly64x2_t __s1 = __p1; \
62928 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
62929 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
62930 __ret = (poly64x2_t) __builtin_neon_vsliq_n_v((int8x16_t)__rev0, (int8x16_t)__rev1, __p2, 38); \
62931 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
62932 __ret; \
62933})
62216__ai uint16x8_t vzip1q_u16(uint16x8_t __p0, uint16x8_t __p1) {
62217 uint16x8_t __ret;
62218 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
62219 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
62220 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 8, 1, 9, 2, 10, 3, 11);
62221 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
62222 return __ret;
62223}
6293462224#endif
6293562225
62936__ai uint8_t vsqaddb_u8(uint8_t __p0, int8_t __p1) {
62937 uint8_t __ret;
62938 __ret = (uint8_t) __builtin_neon_vsqaddb_u8(__p0, __p1);
62226#ifdef __LITTLE_ENDIAN__
62227__ai int8x16_t vzip1q_s8(int8x16_t __p0, int8x16_t __p1) {
62228 int8x16_t __ret;
62229 __ret = __builtin_shufflevector(__p0, __p1, 0, 16, 1, 17, 2, 18, 3, 19, 4, 20, 5, 21, 6, 22, 7, 23);
6293962230 return __ret;
6294062231}
62941__ai uint32_t vsqadds_u32(uint32_t __p0, int32_t __p1) {
62942 uint32_t __ret;
62943 __ret = (uint32_t) __builtin_neon_vsqadds_u32(__p0, __p1);
62232#else
62233__ai int8x16_t vzip1q_s8(int8x16_t __p0, int8x16_t __p1) {
62234 int8x16_t __ret;
62235 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
62236 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
62237 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 16, 1, 17, 2, 18, 3, 19, 4, 20, 5, 21, 6, 22, 7, 23);
62238 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
6294462239 return __ret;
6294562240}
62946__ai uint64_t vsqaddd_u64(uint64_t __p0, int64_t __p1) {
62947 uint64_t __ret;
62948 __ret = (uint64_t) __builtin_neon_vsqaddd_u64(__p0, __p1);
62241#endif
62242
62243#ifdef __LITTLE_ENDIAN__
62244__ai float64x2_t vzip1q_f64(float64x2_t __p0, float64x2_t __p1) {
62245 float64x2_t __ret;
62246 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
6294962247 return __ret;
6295062248}
62951__ai uint16_t vsqaddh_u16(uint16_t __p0, int16_t __p1) {
62952 uint16_t __ret;
62953 __ret = (uint16_t) __builtin_neon_vsqaddh_u16(__p0, __p1);
62249#else
62250__ai float64x2_t vzip1q_f64(float64x2_t __p0, float64x2_t __p1) {
62251 float64x2_t __ret;
62252 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
62253 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
62254 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
62255 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6295462256 return __ret;
6295562257}
62258#endif
62259
6295662260#ifdef __LITTLE_ENDIAN__
62957__ai uint8x16_t vsqaddq_u8(uint8x16_t __p0, int8x16_t __p1) {
62958 uint8x16_t __ret;
62959 __ret = (uint8x16_t) __builtin_neon_vsqaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 48);
62261__ai float32x4_t vzip1q_f32(float32x4_t __p0, float32x4_t __p1) {
62262 float32x4_t __ret;
62263 __ret = __builtin_shufflevector(__p0, __p1, 0, 4, 1, 5);
6296062264 return __ret;
6296162265}
6296262266#else
62963__ai uint8x16_t vsqaddq_u8(uint8x16_t __p0, int8x16_t __p1) {
62964 uint8x16_t __ret;
62965 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
62966 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
62967 __ret = (uint8x16_t) __builtin_neon_vsqaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 48);
62968 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
62267__ai float32x4_t vzip1q_f32(float32x4_t __p0, float32x4_t __p1) {
62268 float32x4_t __ret;
62269 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
62270 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
62271 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 4, 1, 5);
62272 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6296962273 return __ret;
6297062274}
6297162275#endif
6297262276
6297362277#ifdef __LITTLE_ENDIAN__
62974__ai uint32x4_t vsqaddq_u32(uint32x4_t __p0, int32x4_t __p1) {
62975 uint32x4_t __ret;
62976 __ret = (uint32x4_t) __builtin_neon_vsqaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 50);
62278__ai int32x4_t vzip1q_s32(int32x4_t __p0, int32x4_t __p1) {
62279 int32x4_t __ret;
62280 __ret = __builtin_shufflevector(__p0, __p1, 0, 4, 1, 5);
6297762281 return __ret;
6297862282}
6297962283#else
62980__ai uint32x4_t vsqaddq_u32(uint32x4_t __p0, int32x4_t __p1) {
62981 uint32x4_t __ret;
62982 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
62284__ai int32x4_t vzip1q_s32(int32x4_t __p0, int32x4_t __p1) {
62285 int32x4_t __ret;
62286 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
6298362287 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
62984 __ret = (uint32x4_t) __builtin_neon_vsqaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 50);
62288 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 4, 1, 5);
6298562289 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6298662290 return __ret;
6298762291}
6298862292#endif
6298962293
6299062294#ifdef __LITTLE_ENDIAN__
62991__ai uint64x2_t vsqaddq_u64(uint64x2_t __p0, int64x2_t __p1) {
62992 uint64x2_t __ret;
62993 __ret = (uint64x2_t) __builtin_neon_vsqaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 51);
62295__ai int64x2_t vzip1q_s64(int64x2_t __p0, int64x2_t __p1) {
62296 int64x2_t __ret;
62297 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
6299462298 return __ret;
6299562299}
6299662300#else
62997__ai uint64x2_t vsqaddq_u64(uint64x2_t __p0, int64x2_t __p1) {
62998 uint64x2_t __ret;
62999 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
62301__ai int64x2_t vzip1q_s64(int64x2_t __p0, int64x2_t __p1) {
62302 int64x2_t __ret;
62303 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
6300062304 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
63001 __ret = (uint64x2_t) __builtin_neon_vsqaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 51);
62305 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
6300262306 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6300362307 return __ret;
6300462308}
6300562309#endif
6300662310
6300762311#ifdef __LITTLE_ENDIAN__
63008__ai uint16x8_t vsqaddq_u16(uint16x8_t __p0, int16x8_t __p1) {
63009 uint16x8_t __ret;
63010 __ret = (uint16x8_t) __builtin_neon_vsqaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 49);
62312__ai int16x8_t vzip1q_s16(int16x8_t __p0, int16x8_t __p1) {
62313 int16x8_t __ret;
62314 __ret = __builtin_shufflevector(__p0, __p1, 0, 8, 1, 9, 2, 10, 3, 11);
6301162315 return __ret;
6301262316}
6301362317#else
63014__ai uint16x8_t vsqaddq_u16(uint16x8_t __p0, int16x8_t __p1) {
63015 uint16x8_t __ret;
63016 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
62318__ai int16x8_t vzip1q_s16(int16x8_t __p0, int16x8_t __p1) {
62319 int16x8_t __ret;
62320 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
6301762321 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
63018 __ret = (uint16x8_t) __builtin_neon_vsqaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 49);
62322 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 8, 1, 9, 2, 10, 3, 11);
6301962323 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6302062324 return __ret;
6302162325}
6302262326#endif
6302362327
6302462328#ifdef __LITTLE_ENDIAN__
63025__ai uint8x8_t vsqadd_u8(uint8x8_t __p0, int8x8_t __p1) {
62329__ai uint8x8_t vzip1_u8(uint8x8_t __p0, uint8x8_t __p1) {
6302662330 uint8x8_t __ret;
63027 __ret = (uint8x8_t) __builtin_neon_vsqadd_v((int8x8_t)__p0, (int8x8_t)__p1, 16);
62331 __ret = __builtin_shufflevector(__p0, __p1, 0, 8, 1, 9, 2, 10, 3, 11);
6302862332 return __ret;
6302962333}
6303062334#else
63031__ai uint8x8_t vsqadd_u8(uint8x8_t __p0, int8x8_t __p1) {
62335__ai uint8x8_t vzip1_u8(uint8x8_t __p0, uint8x8_t __p1) {
6303262336 uint8x8_t __ret;
6303362337 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
63034 int8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
63035 __ret = (uint8x8_t) __builtin_neon_vsqadd_v((int8x8_t)__rev0, (int8x8_t)__rev1, 16);
62338 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
62339 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 8, 1, 9, 2, 10, 3, 11);
6303662340 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6303762341 return __ret;
6303862342}
6303962343#endif
6304062344
6304162345#ifdef __LITTLE_ENDIAN__
63042__ai uint32x2_t vsqadd_u32(uint32x2_t __p0, int32x2_t __p1) {
62346__ai uint32x2_t vzip1_u32(uint32x2_t __p0, uint32x2_t __p1) {
6304362347 uint32x2_t __ret;
63044 __ret = (uint32x2_t) __builtin_neon_vsqadd_v((int8x8_t)__p0, (int8x8_t)__p1, 18);
62348 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
6304562349 return __ret;
6304662350}
6304762351#else
63048__ai uint32x2_t vsqadd_u32(uint32x2_t __p0, int32x2_t __p1) {
62352__ai uint32x2_t vzip1_u32(uint32x2_t __p0, uint32x2_t __p1) {
6304962353 uint32x2_t __ret;
6305062354 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
63051 int32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
63052 __ret = (uint32x2_t) __builtin_neon_vsqadd_v((int8x8_t)__rev0, (int8x8_t)__rev1, 18);
62355 uint32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
62356 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
6305362357 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6305462358 return __ret;
6305562359}
6305662360#endif
6305762361
63058__ai uint64x1_t vsqadd_u64(uint64x1_t __p0, int64x1_t __p1) {
63059 uint64x1_t __ret;
63060 __ret = (uint64x1_t) __builtin_neon_vsqadd_v((int8x8_t)__p0, (int8x8_t)__p1, 19);
63061 return __ret;
63062}
6306362362#ifdef __LITTLE_ENDIAN__
63064__ai uint16x4_t vsqadd_u16(uint16x4_t __p0, int16x4_t __p1) {
62363__ai uint16x4_t vzip1_u16(uint16x4_t __p0, uint16x4_t __p1) {
6306562364 uint16x4_t __ret;
63066 __ret = (uint16x4_t) __builtin_neon_vsqadd_v((int8x8_t)__p0, (int8x8_t)__p1, 17);
62365 __ret = __builtin_shufflevector(__p0, __p1, 0, 4, 1, 5);
6306762366 return __ret;
6306862367}
6306962368#else
63070__ai uint16x4_t vsqadd_u16(uint16x4_t __p0, int16x4_t __p1) {
62369__ai uint16x4_t vzip1_u16(uint16x4_t __p0, uint16x4_t __p1) {
6307162370 uint16x4_t __ret;
6307262371 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
63073 int16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
63074 __ret = (uint16x4_t) __builtin_neon_vsqadd_v((int8x8_t)__rev0, (int8x8_t)__rev1, 17);
62372 uint16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
62373 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 4, 1, 5);
6307562374 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6307662375 return __ret;
6307762376}
6307862377#endif
6307962378
6308062379#ifdef __LITTLE_ENDIAN__
63081__ai float64x2_t vsqrtq_f64(float64x2_t __p0) {
63082 float64x2_t __ret;
63083 __ret = (float64x2_t) __builtin_neon_vsqrtq_v((int8x16_t)__p0, 42);
62380__ai int8x8_t vzip1_s8(int8x8_t __p0, int8x8_t __p1) {
62381 int8x8_t __ret;
62382 __ret = __builtin_shufflevector(__p0, __p1, 0, 8, 1, 9, 2, 10, 3, 11);
6308462383 return __ret;
6308562384}
6308662385#else
63087__ai float64x2_t vsqrtq_f64(float64x2_t __p0) {
63088 float64x2_t __ret;
63089 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
63090 __ret = (float64x2_t) __builtin_neon_vsqrtq_v((int8x16_t)__rev0, 42);
63091 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
62386__ai int8x8_t vzip1_s8(int8x8_t __p0, int8x8_t __p1) {
62387 int8x8_t __ret;
62388 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
62389 int8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
62390 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 8, 1, 9, 2, 10, 3, 11);
62391 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6309262392 return __ret;
6309362393}
6309462394#endif
6309562395
6309662396#ifdef __LITTLE_ENDIAN__
63097__ai float32x4_t vsqrtq_f32(float32x4_t __p0) {
63098 float32x4_t __ret;
63099 __ret = (float32x4_t) __builtin_neon_vsqrtq_v((int8x16_t)__p0, 41);
62397__ai float32x2_t vzip1_f32(float32x2_t __p0, float32x2_t __p1) {
62398 float32x2_t __ret;
62399 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
6310062400 return __ret;
6310162401}
6310262402#else
63103__ai float32x4_t vsqrtq_f32(float32x4_t __p0) {
63104 float32x4_t __ret;
63105 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
63106 __ret = (float32x4_t) __builtin_neon_vsqrtq_v((int8x16_t)__rev0, 41);
63107 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
62403__ai float32x2_t vzip1_f32(float32x2_t __p0, float32x2_t __p1) {
62404 float32x2_t __ret;
62405 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
62406 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
62407 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
62408 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6310862409 return __ret;
6310962410}
6311062411#endif
6311162412
63112__ai float64x1_t vsqrt_f64(float64x1_t __p0) {
63113 float64x1_t __ret;
63114 __ret = (float64x1_t) __builtin_neon_vsqrt_v((int8x8_t)__p0, 10);
63115 return __ret;
63116}
6311762413#ifdef __LITTLE_ENDIAN__
63118__ai float32x2_t vsqrt_f32(float32x2_t __p0) {
63119 float32x2_t __ret;
63120 __ret = (float32x2_t) __builtin_neon_vsqrt_v((int8x8_t)__p0, 9);
62414__ai int32x2_t vzip1_s32(int32x2_t __p0, int32x2_t __p1) {
62415 int32x2_t __ret;
62416 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
6312162417 return __ret;
6312262418}
6312362419#else
63124__ai float32x2_t vsqrt_f32(float32x2_t __p0) {
63125 float32x2_t __ret;
63126 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
63127 __ret = (float32x2_t) __builtin_neon_vsqrt_v((int8x8_t)__rev0, 9);
62420__ai int32x2_t vzip1_s32(int32x2_t __p0, int32x2_t __p1) {
62421 int32x2_t __ret;
62422 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
62423 int32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
62424 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
6312862425 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6312962426 return __ret;
6313062427}
6313162428#endif
6313262429
63133#define vsrad_n_u64(__p0, __p1, __p2) __extension__ ({ \
63134 uint64_t __ret; \
63135 uint64_t __s0 = __p0; \
63136 uint64_t __s1 = __p1; \
63137 __ret = (uint64_t) __builtin_neon_vsrad_n_u64(__s0, __s1, __p2); \
63138 __ret; \
63139})
63140#define vsrad_n_s64(__p0, __p1, __p2) __extension__ ({ \
63141 int64_t __ret; \
63142 int64_t __s0 = __p0; \
63143 int64_t __s1 = __p1; \
63144 __ret = (int64_t) __builtin_neon_vsrad_n_s64(__s0, __s1, __p2); \
63145 __ret; \
63146})
63147#define vsrid_n_u64(__p0, __p1, __p2) __extension__ ({ \
63148 uint64_t __ret; \
63149 uint64_t __s0 = __p0; \
63150 uint64_t __s1 = __p1; \
63151 __ret = (uint64_t) __builtin_neon_vsrid_n_u64(__s0, __s1, __p2); \
63152 __ret; \
63153})
63154#define vsrid_n_s64(__p0, __p1, __p2) __extension__ ({ \
63155 int64_t __ret; \
63156 int64_t __s0 = __p0; \
63157 int64_t __s1 = __p1; \
63158 __ret = (int64_t) __builtin_neon_vsrid_n_s64(__s0, __s1, __p2); \
63159 __ret; \
63160})
63161#define vsri_n_p64(__p0, __p1, __p2) __extension__ ({ \
63162 poly64x1_t __ret; \
63163 poly64x1_t __s0 = __p0; \
63164 poly64x1_t __s1 = __p1; \
63165 __ret = (poly64x1_t) __builtin_neon_vsri_n_v((int8x8_t)__s0, (int8x8_t)__s1, __p2, 6); \
63166 __ret; \
63167})
63168#ifdef __LITTLE_ENDIAN__
63169#define vsriq_n_p64(__p0, __p1, __p2) __extension__ ({ \
63170 poly64x2_t __ret; \
63171 poly64x2_t __s0 = __p0; \
63172 poly64x2_t __s1 = __p1; \
63173 __ret = (poly64x2_t) __builtin_neon_vsriq_n_v((int8x16_t)__s0, (int8x16_t)__s1, __p2, 38); \
63174 __ret; \
63175})
63176#else
63177#define vsriq_n_p64(__p0, __p1, __p2) __extension__ ({ \
63178 poly64x2_t __ret; \
63179 poly64x2_t __s0 = __p0; \
63180 poly64x2_t __s1 = __p1; \
63181 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
63182 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
63183 __ret = (poly64x2_t) __builtin_neon_vsriq_n_v((int8x16_t)__rev0, (int8x16_t)__rev1, __p2, 38); \
63184 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
63185 __ret; \
63186})
63187#endif
63188
63189#define vst1_p64(__p0, __p1) __extension__ ({ \
63190 poly64x1_t __s1 = __p1; \
63191 __builtin_neon_vst1_v(__p0, (int8x8_t)__s1, 6); \
63192})
63193#ifdef __LITTLE_ENDIAN__
63194#define vst1q_p64(__p0, __p1) __extension__ ({ \
63195 poly64x2_t __s1 = __p1; \
63196 __builtin_neon_vst1q_v(__p0, (int8x16_t)__s1, 38); \
63197})
63198#else
63199#define vst1q_p64(__p0, __p1) __extension__ ({ \
63200 poly64x2_t __s1 = __p1; \
63201 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
63202 __builtin_neon_vst1q_v(__p0, (int8x16_t)__rev1, 38); \
63203})
63204#endif
63205
63206#ifdef __LITTLE_ENDIAN__
63207#define vst1q_f64(__p0, __p1) __extension__ ({ \
63208 float64x2_t __s1 = __p1; \
63209 __builtin_neon_vst1q_v(__p0, (int8x16_t)__s1, 42); \
63210})
63211#else
63212#define vst1q_f64(__p0, __p1) __extension__ ({ \
63213 float64x2_t __s1 = __p1; \
63214 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
63215 __builtin_neon_vst1q_v(__p0, (int8x16_t)__rev1, 42); \
63216})
63217#endif
63218
63219#define vst1_f64(__p0, __p1) __extension__ ({ \
63220 float64x1_t __s1 = __p1; \
63221 __builtin_neon_vst1_v(__p0, (int8x8_t)__s1, 10); \
63222})
63223#define vst1_lane_p64(__p0, __p1, __p2) __extension__ ({ \
63224 poly64x1_t __s1 = __p1; \
63225 __builtin_neon_vst1_lane_v(__p0, (int8x8_t)__s1, __p2, 6); \
63226})
63227#ifdef __LITTLE_ENDIAN__
63228#define vst1q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
63229 poly64x2_t __s1 = __p1; \
63230 __builtin_neon_vst1q_lane_v(__p0, (int8x16_t)__s1, __p2, 38); \
63231})
63232#else
63233#define vst1q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
63234 poly64x2_t __s1 = __p1; \
63235 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
63236 __builtin_neon_vst1q_lane_v(__p0, (int8x16_t)__rev1, __p2, 38); \
63237})
63238#endif
63239
63240#ifdef __LITTLE_ENDIAN__
63241#define vst1q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
63242 float64x2_t __s1 = __p1; \
63243 __builtin_neon_vst1q_lane_v(__p0, (int8x16_t)__s1, __p2, 42); \
63244})
63245#else
63246#define vst1q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
63247 float64x2_t __s1 = __p1; \
63248 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
63249 __builtin_neon_vst1q_lane_v(__p0, (int8x16_t)__rev1, __p2, 42); \
63250})
63251#endif
63252
63253#define vst1_lane_f64(__p0, __p1, __p2) __extension__ ({ \
63254 float64x1_t __s1 = __p1; \
63255 __builtin_neon_vst1_lane_v(__p0, (int8x8_t)__s1, __p2, 10); \
63256})
63257#define vst1_p64_x2(__p0, __p1) __extension__ ({ \
63258 poly64x1x2_t __s1 = __p1; \
63259 __builtin_neon_vst1_x2_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], 6); \
63260})
63261#ifdef __LITTLE_ENDIAN__
63262#define vst1q_p64_x2(__p0, __p1) __extension__ ({ \
63263 poly64x2x2_t __s1 = __p1; \
63264 __builtin_neon_vst1q_x2_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], 38); \
63265})
63266#else
63267#define vst1q_p64_x2(__p0, __p1) __extension__ ({ \
63268 poly64x2x2_t __s1 = __p1; \
63269 poly64x2x2_t __rev1; \
63270 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63271 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63272 __builtin_neon_vst1q_x2_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], 38); \
63273})
63274#endif
63275
63276#ifdef __LITTLE_ENDIAN__
63277#define vst1q_f64_x2(__p0, __p1) __extension__ ({ \
63278 float64x2x2_t __s1 = __p1; \
63279 __builtin_neon_vst1q_x2_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], 42); \
63280})
63281#else
63282#define vst1q_f64_x2(__p0, __p1) __extension__ ({ \
63283 float64x2x2_t __s1 = __p1; \
63284 float64x2x2_t __rev1; \
63285 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63286 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63287 __builtin_neon_vst1q_x2_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], 42); \
63288})
63289#endif
63290
63291#define vst1_f64_x2(__p0, __p1) __extension__ ({ \
63292 float64x1x2_t __s1 = __p1; \
63293 __builtin_neon_vst1_x2_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], 10); \
63294})
63295#define vst1_p64_x3(__p0, __p1) __extension__ ({ \
63296 poly64x1x3_t __s1 = __p1; \
63297 __builtin_neon_vst1_x3_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], 6); \
63298})
63299#ifdef __LITTLE_ENDIAN__
63300#define vst1q_p64_x3(__p0, __p1) __extension__ ({ \
63301 poly64x2x3_t __s1 = __p1; \
63302 __builtin_neon_vst1q_x3_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], 38); \
63303})
63304#else
63305#define vst1q_p64_x3(__p0, __p1) __extension__ ({ \
63306 poly64x2x3_t __s1 = __p1; \
63307 poly64x2x3_t __rev1; \
63308 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63309 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63310 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
63311 __builtin_neon_vst1q_x3_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], 38); \
63312})
63313#endif
63314
63315#ifdef __LITTLE_ENDIAN__
63316#define vst1q_f64_x3(__p0, __p1) __extension__ ({ \
63317 float64x2x3_t __s1 = __p1; \
63318 __builtin_neon_vst1q_x3_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], 42); \
63319})
63320#else
63321#define vst1q_f64_x3(__p0, __p1) __extension__ ({ \
63322 float64x2x3_t __s1 = __p1; \
63323 float64x2x3_t __rev1; \
63324 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63325 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63326 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
63327 __builtin_neon_vst1q_x3_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], 42); \
63328})
63329#endif
63330
63331#define vst1_f64_x3(__p0, __p1) __extension__ ({ \
63332 float64x1x3_t __s1 = __p1; \
63333 __builtin_neon_vst1_x3_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], 10); \
63334})
63335#define vst1_p64_x4(__p0, __p1) __extension__ ({ \
63336 poly64x1x4_t __s1 = __p1; \
63337 __builtin_neon_vst1_x4_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], 6); \
63338})
63339#ifdef __LITTLE_ENDIAN__
63340#define vst1q_p64_x4(__p0, __p1) __extension__ ({ \
63341 poly64x2x4_t __s1 = __p1; \
63342 __builtin_neon_vst1q_x4_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], 38); \
63343})
63344#else
63345#define vst1q_p64_x4(__p0, __p1) __extension__ ({ \
63346 poly64x2x4_t __s1 = __p1; \
63347 poly64x2x4_t __rev1; \
63348 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63349 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63350 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
63351 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 1, 0); \
63352 __builtin_neon_vst1q_x4_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], 38); \
63353})
63354#endif
63355
63356#ifdef __LITTLE_ENDIAN__
63357#define vst1q_f64_x4(__p0, __p1) __extension__ ({ \
63358 float64x2x4_t __s1 = __p1; \
63359 __builtin_neon_vst1q_x4_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], 42); \
63360})
63361#else
63362#define vst1q_f64_x4(__p0, __p1) __extension__ ({ \
63363 float64x2x4_t __s1 = __p1; \
63364 float64x2x4_t __rev1; \
63365 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63366 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63367 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
63368 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 1, 0); \
63369 __builtin_neon_vst1q_x4_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], 42); \
63370})
63371#endif
63372
63373#define vst1_f64_x4(__p0, __p1) __extension__ ({ \
63374 float64x1x4_t __s1 = __p1; \
63375 __builtin_neon_vst1_x4_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], 10); \
63376})
63377#define vst2_p64(__p0, __p1) __extension__ ({ \
63378 poly64x1x2_t __s1 = __p1; \
63379 __builtin_neon_vst2_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], 6); \
63380})
63381#ifdef __LITTLE_ENDIAN__
63382#define vst2q_p64(__p0, __p1) __extension__ ({ \
63383 poly64x2x2_t __s1 = __p1; \
63384 __builtin_neon_vst2q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], 38); \
63385})
63386#else
63387#define vst2q_p64(__p0, __p1) __extension__ ({ \
63388 poly64x2x2_t __s1 = __p1; \
63389 poly64x2x2_t __rev1; \
63390 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63391 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63392 __builtin_neon_vst2q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], 38); \
63393})
63394#endif
63395
6339662430#ifdef __LITTLE_ENDIAN__
63397#define vst2q_u64(__p0, __p1) __extension__ ({ \
63398 uint64x2x2_t __s1 = __p1; \
63399 __builtin_neon_vst2q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], 51); \
63400})
62431__ai int16x4_t vzip1_s16(int16x4_t __p0, int16x4_t __p1) {
62432 int16x4_t __ret;
62433 __ret = __builtin_shufflevector(__p0, __p1, 0, 4, 1, 5);
62434 return __ret;
62435}
6340162436#else
63402#define vst2q_u64(__p0, __p1) __extension__ ({ \
63403 uint64x2x2_t __s1 = __p1; \
63404 uint64x2x2_t __rev1; \
63405 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63406 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63407 __builtin_neon_vst2q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], 51); \
63408})
62437__ai int16x4_t vzip1_s16(int16x4_t __p0, int16x4_t __p1) {
62438 int16x4_t __ret;
62439 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
62440 int16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
62441 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 4, 1, 5);
62442 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
62443 return __ret;
62444}
6340962445#endif
6341062446
6341162447#ifdef __LITTLE_ENDIAN__
63412#define vst2q_f64(__p0, __p1) __extension__ ({ \
63413 float64x2x2_t __s1 = __p1; \
63414 __builtin_neon_vst2q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], 42); \
63415})
62448__ai poly8x8_t vzip2_p8(poly8x8_t __p0, poly8x8_t __p1) {
62449 poly8x8_t __ret;
62450 __ret = __builtin_shufflevector(__p0, __p1, 4, 12, 5, 13, 6, 14, 7, 15);
62451 return __ret;
62452}
6341662453#else
63417#define vst2q_f64(__p0, __p1) __extension__ ({ \
63418 float64x2x2_t __s1 = __p1; \
63419 float64x2x2_t __rev1; \
63420 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63421 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63422 __builtin_neon_vst2q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], 42); \
63423})
62454__ai poly8x8_t vzip2_p8(poly8x8_t __p0, poly8x8_t __p1) {
62455 poly8x8_t __ret;
62456 poly8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
62457 poly8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
62458 __ret = __builtin_shufflevector(__rev0, __rev1, 4, 12, 5, 13, 6, 14, 7, 15);
62459 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
62460 return __ret;
62461}
6342462462#endif
6342562463
6342662464#ifdef __LITTLE_ENDIAN__
63427#define vst2q_s64(__p0, __p1) __extension__ ({ \
63428 int64x2x2_t __s1 = __p1; \
63429 __builtin_neon_vst2q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], 35); \
63430})
62465__ai poly16x4_t vzip2_p16(poly16x4_t __p0, poly16x4_t __p1) {
62466 poly16x4_t __ret;
62467 __ret = __builtin_shufflevector(__p0, __p1, 2, 6, 3, 7);
62468 return __ret;
62469}
6343162470#else
63432#define vst2q_s64(__p0, __p1) __extension__ ({ \
63433 int64x2x2_t __s1 = __p1; \
63434 int64x2x2_t __rev1; \
63435 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63436 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63437 __builtin_neon_vst2q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], 35); \
63438})
62471__ai poly16x4_t vzip2_p16(poly16x4_t __p0, poly16x4_t __p1) {
62472 poly16x4_t __ret;
62473 poly16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
62474 poly16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
62475 __ret = __builtin_shufflevector(__rev0, __rev1, 2, 6, 3, 7);
62476 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
62477 return __ret;
62478}
6343962479#endif
6344062480
63441#define vst2_f64(__p0, __p1) __extension__ ({ \
63442 float64x1x2_t __s1 = __p1; \
63443 __builtin_neon_vst2_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], 10); \
63444})
63445#define vst2_lane_p64(__p0, __p1, __p2) __extension__ ({ \
63446 poly64x1x2_t __s1 = __p1; \
63447 __builtin_neon_vst2_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], __p2, 6); \
63448})
6344962481#ifdef __LITTLE_ENDIAN__
63450#define vst2q_lane_p8(__p0, __p1, __p2) __extension__ ({ \
63451 poly8x16x2_t __s1 = __p1; \
63452 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 36); \
63453})
62482__ai poly8x16_t vzip2q_p8(poly8x16_t __p0, poly8x16_t __p1) {
62483 poly8x16_t __ret;
62484 __ret = __builtin_shufflevector(__p0, __p1, 8, 24, 9, 25, 10, 26, 11, 27, 12, 28, 13, 29, 14, 30, 15, 31);
62485 return __ret;
62486}
6345462487#else
63455#define vst2q_lane_p8(__p0, __p1, __p2) __extension__ ({ \
63456 poly8x16x2_t __s1 = __p1; \
63457 poly8x16x2_t __rev1; \
63458 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63459 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63460 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 36); \
63461})
62488__ai poly8x16_t vzip2q_p8(poly8x16_t __p0, poly8x16_t __p1) {
62489 poly8x16_t __ret;
62490 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
62491 poly8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
62492 __ret = __builtin_shufflevector(__rev0, __rev1, 8, 24, 9, 25, 10, 26, 11, 27, 12, 28, 13, 29, 14, 30, 15, 31);
62493 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
62494 return __ret;
62495}
6346262496#endif
6346362497
6346462498#ifdef __LITTLE_ENDIAN__
63465#define vst2q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
63466 poly64x2x2_t __s1 = __p1; \
63467 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 38); \
63468})
62499__ai poly64x2_t vzip2q_p64(poly64x2_t __p0, poly64x2_t __p1) {
62500 poly64x2_t __ret;
62501 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
62502 return __ret;
62503}
6346962504#else
63470#define vst2q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
63471 poly64x2x2_t __s1 = __p1; \
63472 poly64x2x2_t __rev1; \
63473 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63474 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63475 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 38); \
63476})
62505__ai poly64x2_t vzip2q_p64(poly64x2_t __p0, poly64x2_t __p1) {
62506 poly64x2_t __ret;
62507 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
62508 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
62509 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
62510 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
62511 return __ret;
62512}
6347762513#endif
6347862514
6347962515#ifdef __LITTLE_ENDIAN__
63480#define vst2q_lane_u8(__p0, __p1, __p2) __extension__ ({ \
63481 uint8x16x2_t __s1 = __p1; \
63482 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 48); \
63483})
62516__ai poly16x8_t vzip2q_p16(poly16x8_t __p0, poly16x8_t __p1) {
62517 poly16x8_t __ret;
62518 __ret = __builtin_shufflevector(__p0, __p1, 4, 12, 5, 13, 6, 14, 7, 15);
62519 return __ret;
62520}
6348462521#else
63485#define vst2q_lane_u8(__p0, __p1, __p2) __extension__ ({ \
63486 uint8x16x2_t __s1 = __p1; \
63487 uint8x16x2_t __rev1; \
63488 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63489 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63490 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 48); \
63491})
62522__ai poly16x8_t vzip2q_p16(poly16x8_t __p0, poly16x8_t __p1) {
62523 poly16x8_t __ret;
62524 poly16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
62525 poly16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
62526 __ret = __builtin_shufflevector(__rev0, __rev1, 4, 12, 5, 13, 6, 14, 7, 15);
62527 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
62528 return __ret;
62529}
6349262530#endif
6349362531
6349462532#ifdef __LITTLE_ENDIAN__
63495#define vst2q_lane_u64(__p0, __p1, __p2) __extension__ ({ \
63496 uint64x2x2_t __s1 = __p1; \
63497 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 51); \
63498})
62533__ai uint8x16_t vzip2q_u8(uint8x16_t __p0, uint8x16_t __p1) {
62534 uint8x16_t __ret;
62535 __ret = __builtin_shufflevector(__p0, __p1, 8, 24, 9, 25, 10, 26, 11, 27, 12, 28, 13, 29, 14, 30, 15, 31);
62536 return __ret;
62537}
6349962538#else
63500#define vst2q_lane_u64(__p0, __p1, __p2) __extension__ ({ \
63501 uint64x2x2_t __s1 = __p1; \
63502 uint64x2x2_t __rev1; \
63503 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63504 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63505 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 51); \
63506})
62539__ai uint8x16_t vzip2q_u8(uint8x16_t __p0, uint8x16_t __p1) {
62540 uint8x16_t __ret;
62541 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
62542 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
62543 __ret = __builtin_shufflevector(__rev0, __rev1, 8, 24, 9, 25, 10, 26, 11, 27, 12, 28, 13, 29, 14, 30, 15, 31);
62544 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
62545 return __ret;
62546}
6350762547#endif
6350862548
6350962549#ifdef __LITTLE_ENDIAN__
63510#define vst2q_lane_s8(__p0, __p1, __p2) __extension__ ({ \
63511 int8x16x2_t __s1 = __p1; \
63512 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 32); \
63513})
62550__ai uint32x4_t vzip2q_u32(uint32x4_t __p0, uint32x4_t __p1) {
62551 uint32x4_t __ret;
62552 __ret = __builtin_shufflevector(__p0, __p1, 2, 6, 3, 7);
62553 return __ret;
62554}
6351462555#else
63515#define vst2q_lane_s8(__p0, __p1, __p2) __extension__ ({ \
63516 int8x16x2_t __s1 = __p1; \
63517 int8x16x2_t __rev1; \
63518 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63519 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63520 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 32); \
63521})
62556__ai uint32x4_t vzip2q_u32(uint32x4_t __p0, uint32x4_t __p1) {
62557 uint32x4_t __ret;
62558 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
62559 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
62560 __ret = __builtin_shufflevector(__rev0, __rev1, 2, 6, 3, 7);
62561 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
62562 return __ret;
62563}
6352262564#endif
6352362565
6352462566#ifdef __LITTLE_ENDIAN__
63525#define vst2q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
63526 float64x2x2_t __s1 = __p1; \
63527 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 42); \
63528})
62567__ai uint64x2_t vzip2q_u64(uint64x2_t __p0, uint64x2_t __p1) {
62568 uint64x2_t __ret;
62569 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
62570 return __ret;
62571}
6352962572#else
63530#define vst2q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
63531 float64x2x2_t __s1 = __p1; \
63532 float64x2x2_t __rev1; \
63533 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63534 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63535 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 42); \
63536})
62573__ai uint64x2_t vzip2q_u64(uint64x2_t __p0, uint64x2_t __p1) {
62574 uint64x2_t __ret;
62575 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
62576 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
62577 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
62578 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
62579 return __ret;
62580}
6353762581#endif
6353862582
6353962583#ifdef __LITTLE_ENDIAN__
63540#define vst2q_lane_s64(__p0, __p1, __p2) __extension__ ({ \
63541 int64x2x2_t __s1 = __p1; \
63542 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], __p2, 35); \
63543})
62584__ai uint16x8_t vzip2q_u16(uint16x8_t __p0, uint16x8_t __p1) {
62585 uint16x8_t __ret;
62586 __ret = __builtin_shufflevector(__p0, __p1, 4, 12, 5, 13, 6, 14, 7, 15);
62587 return __ret;
62588}
6354462589#else
63545#define vst2q_lane_s64(__p0, __p1, __p2) __extension__ ({ \
63546 int64x2x2_t __s1 = __p1; \
63547 int64x2x2_t __rev1; \
63548 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63549 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63550 __builtin_neon_vst2q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], __p2, 35); \
63551})
62590__ai uint16x8_t vzip2q_u16(uint16x8_t __p0, uint16x8_t __p1) {
62591 uint16x8_t __ret;
62592 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
62593 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
62594 __ret = __builtin_shufflevector(__rev0, __rev1, 4, 12, 5, 13, 6, 14, 7, 15);
62595 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
62596 return __ret;
62597}
6355262598#endif
6355362599
63554#define vst2_lane_u64(__p0, __p1, __p2) __extension__ ({ \
63555 uint64x1x2_t __s1 = __p1; \
63556 __builtin_neon_vst2_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], __p2, 19); \
63557})
63558#define vst2_lane_f64(__p0, __p1, __p2) __extension__ ({ \
63559 float64x1x2_t __s1 = __p1; \
63560 __builtin_neon_vst2_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], __p2, 10); \
63561})
63562#define vst2_lane_s64(__p0, __p1, __p2) __extension__ ({ \
63563 int64x1x2_t __s1 = __p1; \
63564 __builtin_neon_vst2_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], __p2, 3); \
63565})
63566#define vst3_p64(__p0, __p1) __extension__ ({ \
63567 poly64x1x3_t __s1 = __p1; \
63568 __builtin_neon_vst3_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], 6); \
63569})
6357062600#ifdef __LITTLE_ENDIAN__
63571#define vst3q_p64(__p0, __p1) __extension__ ({ \
63572 poly64x2x3_t __s1 = __p1; \
63573 __builtin_neon_vst3q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], 38); \
63574})
62601__ai int8x16_t vzip2q_s8(int8x16_t __p0, int8x16_t __p1) {
62602 int8x16_t __ret;
62603 __ret = __builtin_shufflevector(__p0, __p1, 8, 24, 9, 25, 10, 26, 11, 27, 12, 28, 13, 29, 14, 30, 15, 31);
62604 return __ret;
62605}
6357562606#else
63576#define vst3q_p64(__p0, __p1) __extension__ ({ \
63577 poly64x2x3_t __s1 = __p1; \
63578 poly64x2x3_t __rev1; \
63579 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63580 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63581 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
63582 __builtin_neon_vst3q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], 38); \
63583})
62607__ai int8x16_t vzip2q_s8(int8x16_t __p0, int8x16_t __p1) {
62608 int8x16_t __ret;
62609 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
62610 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
62611 __ret = __builtin_shufflevector(__rev0, __rev1, 8, 24, 9, 25, 10, 26, 11, 27, 12, 28, 13, 29, 14, 30, 15, 31);
62612 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
62613 return __ret;
62614}
6358462615#endif
6358562616
6358662617#ifdef __LITTLE_ENDIAN__
63587#define vst3q_u64(__p0, __p1) __extension__ ({ \
63588 uint64x2x3_t __s1 = __p1; \
63589 __builtin_neon_vst3q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], 51); \
63590})
62618__ai float64x2_t vzip2q_f64(float64x2_t __p0, float64x2_t __p1) {
62619 float64x2_t __ret;
62620 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
62621 return __ret;
62622}
6359162623#else
63592#define vst3q_u64(__p0, __p1) __extension__ ({ \
63593 uint64x2x3_t __s1 = __p1; \
63594 uint64x2x3_t __rev1; \
63595 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63596 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63597 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
63598 __builtin_neon_vst3q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], 51); \
63599})
62624__ai float64x2_t vzip2q_f64(float64x2_t __p0, float64x2_t __p1) {
62625 float64x2_t __ret;
62626 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
62627 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
62628 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
62629 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
62630 return __ret;
62631}
6360062632#endif
6360162633
6360262634#ifdef __LITTLE_ENDIAN__
63603#define vst3q_f64(__p0, __p1) __extension__ ({ \
63604 float64x2x3_t __s1 = __p1; \
63605 __builtin_neon_vst3q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], 42); \
63606})
62635__ai float32x4_t vzip2q_f32(float32x4_t __p0, float32x4_t __p1) {
62636 float32x4_t __ret;
62637 __ret = __builtin_shufflevector(__p0, __p1, 2, 6, 3, 7);
62638 return __ret;
62639}
6360762640#else
63608#define vst3q_f64(__p0, __p1) __extension__ ({ \
63609 float64x2x3_t __s1 = __p1; \
63610 float64x2x3_t __rev1; \
63611 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63612 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63613 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
63614 __builtin_neon_vst3q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], 42); \
63615})
62641__ai float32x4_t vzip2q_f32(float32x4_t __p0, float32x4_t __p1) {
62642 float32x4_t __ret;
62643 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
62644 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
62645 __ret = __builtin_shufflevector(__rev0, __rev1, 2, 6, 3, 7);
62646 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
62647 return __ret;
62648}
6361662649#endif
6361762650
6361862651#ifdef __LITTLE_ENDIAN__
63619#define vst3q_s64(__p0, __p1) __extension__ ({ \
63620 int64x2x3_t __s1 = __p1; \
63621 __builtin_neon_vst3q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], 35); \
63622})
62652__ai int32x4_t vzip2q_s32(int32x4_t __p0, int32x4_t __p1) {
62653 int32x4_t __ret;
62654 __ret = __builtin_shufflevector(__p0, __p1, 2, 6, 3, 7);
62655 return __ret;
62656}
6362362657#else
63624#define vst3q_s64(__p0, __p1) __extension__ ({ \
63625 int64x2x3_t __s1 = __p1; \
63626 int64x2x3_t __rev1; \
63627 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63628 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63629 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
63630 __builtin_neon_vst3q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], 35); \
63631})
62658__ai int32x4_t vzip2q_s32(int32x4_t __p0, int32x4_t __p1) {
62659 int32x4_t __ret;
62660 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
62661 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
62662 __ret = __builtin_shufflevector(__rev0, __rev1, 2, 6, 3, 7);
62663 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
62664 return __ret;
62665}
6363262666#endif
6363362667
63634#define vst3_f64(__p0, __p1) __extension__ ({ \
63635 float64x1x3_t __s1 = __p1; \
63636 __builtin_neon_vst3_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], 10); \
63637})
63638#define vst3_lane_p64(__p0, __p1, __p2) __extension__ ({ \
63639 poly64x1x3_t __s1 = __p1; \
63640 __builtin_neon_vst3_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], __p2, 6); \
63641})
6364262668#ifdef __LITTLE_ENDIAN__
63643#define vst3q_lane_p8(__p0, __p1, __p2) __extension__ ({ \
63644 poly8x16x3_t __s1 = __p1; \
63645 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 36); \
63646})
62669__ai int64x2_t vzip2q_s64(int64x2_t __p0, int64x2_t __p1) {
62670 int64x2_t __ret;
62671 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
62672 return __ret;
62673}
6364762674#else
63648#define vst3q_lane_p8(__p0, __p1, __p2) __extension__ ({ \
63649 poly8x16x3_t __s1 = __p1; \
63650 poly8x16x3_t __rev1; \
63651 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63652 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63653 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63654 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 36); \
63655})
62675__ai int64x2_t vzip2q_s64(int64x2_t __p0, int64x2_t __p1) {
62676 int64x2_t __ret;
62677 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
62678 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
62679 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
62680 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
62681 return __ret;
62682}
6365662683#endif
6365762684
6365862685#ifdef __LITTLE_ENDIAN__
63659#define vst3q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
63660 poly64x2x3_t __s1 = __p1; \
63661 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 38); \
63662})
62686__ai int16x8_t vzip2q_s16(int16x8_t __p0, int16x8_t __p1) {
62687 int16x8_t __ret;
62688 __ret = __builtin_shufflevector(__p0, __p1, 4, 12, 5, 13, 6, 14, 7, 15);
62689 return __ret;
62690}
6366362691#else
63664#define vst3q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
63665 poly64x2x3_t __s1 = __p1; \
63666 poly64x2x3_t __rev1; \
63667 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63668 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63669 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
63670 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 38); \
63671})
62692__ai int16x8_t vzip2q_s16(int16x8_t __p0, int16x8_t __p1) {
62693 int16x8_t __ret;
62694 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
62695 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
62696 __ret = __builtin_shufflevector(__rev0, __rev1, 4, 12, 5, 13, 6, 14, 7, 15);
62697 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
62698 return __ret;
62699}
6367262700#endif
6367362701
6367462702#ifdef __LITTLE_ENDIAN__
63675#define vst3q_lane_u8(__p0, __p1, __p2) __extension__ ({ \
63676 uint8x16x3_t __s1 = __p1; \
63677 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 48); \
63678})
62703__ai uint8x8_t vzip2_u8(uint8x8_t __p0, uint8x8_t __p1) {
62704 uint8x8_t __ret;
62705 __ret = __builtin_shufflevector(__p0, __p1, 4, 12, 5, 13, 6, 14, 7, 15);
62706 return __ret;
62707}
6367962708#else
63680#define vst3q_lane_u8(__p0, __p1, __p2) __extension__ ({ \
63681 uint8x16x3_t __s1 = __p1; \
63682 uint8x16x3_t __rev1; \
63683 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63684 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63685 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63686 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 48); \
63687})
62709__ai uint8x8_t vzip2_u8(uint8x8_t __p0, uint8x8_t __p1) {
62710 uint8x8_t __ret;
62711 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
62712 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
62713 __ret = __builtin_shufflevector(__rev0, __rev1, 4, 12, 5, 13, 6, 14, 7, 15);
62714 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
62715 return __ret;
62716}
6368862717#endif
6368962718
6369062719#ifdef __LITTLE_ENDIAN__
63691#define vst3q_lane_u64(__p0, __p1, __p2) __extension__ ({ \
63692 uint64x2x3_t __s1 = __p1; \
63693 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 51); \
63694})
62720__ai uint32x2_t vzip2_u32(uint32x2_t __p0, uint32x2_t __p1) {
62721 uint32x2_t __ret;
62722 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
62723 return __ret;
62724}
6369562725#else
63696#define vst3q_lane_u64(__p0, __p1, __p2) __extension__ ({ \
63697 uint64x2x3_t __s1 = __p1; \
63698 uint64x2x3_t __rev1; \
63699 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63700 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63701 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
63702 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 51); \
63703})
62726__ai uint32x2_t vzip2_u32(uint32x2_t __p0, uint32x2_t __p1) {
62727 uint32x2_t __ret;
62728 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
62729 uint32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
62730 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
62731 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
62732 return __ret;
62733}
6370462734#endif
6370562735
6370662736#ifdef __LITTLE_ENDIAN__
63707#define vst3q_lane_s8(__p0, __p1, __p2) __extension__ ({ \
63708 int8x16x3_t __s1 = __p1; \
63709 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 32); \
63710})
62737__ai uint16x4_t vzip2_u16(uint16x4_t __p0, uint16x4_t __p1) {
62738 uint16x4_t __ret;
62739 __ret = __builtin_shufflevector(__p0, __p1, 2, 6, 3, 7);
62740 return __ret;
62741}
6371162742#else
63712#define vst3q_lane_s8(__p0, __p1, __p2) __extension__ ({ \
63713 int8x16x3_t __s1 = __p1; \
63714 int8x16x3_t __rev1; \
63715 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63716 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63717 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63718 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 32); \
63719})
62743__ai uint16x4_t vzip2_u16(uint16x4_t __p0, uint16x4_t __p1) {
62744 uint16x4_t __ret;
62745 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
62746 uint16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
62747 __ret = __builtin_shufflevector(__rev0, __rev1, 2, 6, 3, 7);
62748 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
62749 return __ret;
62750}
6372062751#endif
6372162752
6372262753#ifdef __LITTLE_ENDIAN__
63723#define vst3q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
63724 float64x2x3_t __s1 = __p1; \
63725 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 42); \
63726})
62754__ai int8x8_t vzip2_s8(int8x8_t __p0, int8x8_t __p1) {
62755 int8x8_t __ret;
62756 __ret = __builtin_shufflevector(__p0, __p1, 4, 12, 5, 13, 6, 14, 7, 15);
62757 return __ret;
62758}
6372762759#else
63728#define vst3q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
63729 float64x2x3_t __s1 = __p1; \
63730 float64x2x3_t __rev1; \
63731 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63732 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63733 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
63734 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 42); \
63735})
62760__ai int8x8_t vzip2_s8(int8x8_t __p0, int8x8_t __p1) {
62761 int8x8_t __ret;
62762 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
62763 int8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
62764 __ret = __builtin_shufflevector(__rev0, __rev1, 4, 12, 5, 13, 6, 14, 7, 15);
62765 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
62766 return __ret;
62767}
6373662768#endif
6373762769
6373862770#ifdef __LITTLE_ENDIAN__
63739#define vst3q_lane_s64(__p0, __p1, __p2) __extension__ ({ \
63740 int64x2x3_t __s1 = __p1; \
63741 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], __p2, 35); \
63742})
62771__ai float32x2_t vzip2_f32(float32x2_t __p0, float32x2_t __p1) {
62772 float32x2_t __ret;
62773 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
62774 return __ret;
62775}
6374362776#else
63744#define vst3q_lane_s64(__p0, __p1, __p2) __extension__ ({ \
63745 int64x2x3_t __s1 = __p1; \
63746 int64x2x3_t __rev1; \
63747 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63748 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63749 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
63750 __builtin_neon_vst3q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], __p2, 35); \
63751})
62777__ai float32x2_t vzip2_f32(float32x2_t __p0, float32x2_t __p1) {
62778 float32x2_t __ret;
62779 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
62780 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
62781 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
62782 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
62783 return __ret;
62784}
6375262785#endif
6375362786
63754#define vst3_lane_u64(__p0, __p1, __p2) __extension__ ({ \
63755 uint64x1x3_t __s1 = __p1; \
63756 __builtin_neon_vst3_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], __p2, 19); \
63757})
63758#define vst3_lane_f64(__p0, __p1, __p2) __extension__ ({ \
63759 float64x1x3_t __s1 = __p1; \
63760 __builtin_neon_vst3_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], __p2, 10); \
63761})
63762#define vst3_lane_s64(__p0, __p1, __p2) __extension__ ({ \
63763 int64x1x3_t __s1 = __p1; \
63764 __builtin_neon_vst3_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], __p2, 3); \
63765})
63766#define vst4_p64(__p0, __p1) __extension__ ({ \
63767 poly64x1x4_t __s1 = __p1; \
63768 __builtin_neon_vst4_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], 6); \
63769})
6377062787#ifdef __LITTLE_ENDIAN__
63771#define vst4q_p64(__p0, __p1) __extension__ ({ \
63772 poly64x2x4_t __s1 = __p1; \
63773 __builtin_neon_vst4q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], 38); \
63774})
63775#else
63776#define vst4q_p64(__p0, __p1) __extension__ ({ \
63777 poly64x2x4_t __s1 = __p1; \
63778 poly64x2x4_t __rev1; \
63779 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63780 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63781 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
63782 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 1, 0); \
63783 __builtin_neon_vst4q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], 38); \
63784})
62788__ai int32x2_t vzip2_s32(int32x2_t __p0, int32x2_t __p1) {
62789 int32x2_t __ret;
62790 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
62791 return __ret;
62792}
62793#else
62794__ai int32x2_t vzip2_s32(int32x2_t __p0, int32x2_t __p1) {
62795 int32x2_t __ret;
62796 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
62797 int32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
62798 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
62799 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
62800 return __ret;
62801}
6378562802#endif
6378662803
6378762804#ifdef __LITTLE_ENDIAN__
63788#define vst4q_u64(__p0, __p1) __extension__ ({ \
63789 uint64x2x4_t __s1 = __p1; \
63790 __builtin_neon_vst4q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], 51); \
63791})
62805__ai int16x4_t vzip2_s16(int16x4_t __p0, int16x4_t __p1) {
62806 int16x4_t __ret;
62807 __ret = __builtin_shufflevector(__p0, __p1, 2, 6, 3, 7);
62808 return __ret;
62809}
6379262810#else
63793#define vst4q_u64(__p0, __p1) __extension__ ({ \
63794 uint64x2x4_t __s1 = __p1; \
63795 uint64x2x4_t __rev1; \
63796 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63797 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63798 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
63799 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 1, 0); \
63800 __builtin_neon_vst4q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], 51); \
63801})
62811__ai int16x4_t vzip2_s16(int16x4_t __p0, int16x4_t __p1) {
62812 int16x4_t __ret;
62813 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
62814 int16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
62815 __ret = __builtin_shufflevector(__rev0, __rev1, 2, 6, 3, 7);
62816 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
62817 return __ret;
62818}
6380262819#endif
6380362820
62821__ai __attribute__((target("aes"))) poly128_t vmull_p64(poly64_t __p0, poly64_t __p1) {
62822 poly128_t __ret;
62823 __ret = (poly128_t) __builtin_neon_vmull_p64(__p0, __p1);
62824 return __ret;
62825}
6380462826#ifdef __LITTLE_ENDIAN__
63805#define vst4q_f64(__p0, __p1) __extension__ ({ \
63806 float64x2x4_t __s1 = __p1; \
63807 __builtin_neon_vst4q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], 42); \
63808})
62827__ai __attribute__((target("aes"))) poly128_t vmull_high_p64(poly64x2_t __p0, poly64x2_t __p1) {
62828 poly128_t __ret;
62829 __ret = vmull_p64((poly64_t)(vget_high_p64(__p0)), (poly64_t)(vget_high_p64(__p1)));
62830 return __ret;
62831}
6380962832#else
63810#define vst4q_f64(__p0, __p1) __extension__ ({ \
63811 float64x2x4_t __s1 = __p1; \
63812 float64x2x4_t __rev1; \
63813 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63814 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63815 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
63816 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 1, 0); \
63817 __builtin_neon_vst4q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], 42); \
63818})
62833__ai __attribute__((target("aes"))) poly128_t vmull_high_p64(poly64x2_t __p0, poly64x2_t __p1) {
62834 poly128_t __ret;
62835 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
62836 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
62837 __ret = vmull_p64((poly64_t)(__noswap_vget_high_p64(__rev0)), (poly64_t)(__noswap_vget_high_p64(__rev1)));
62838 return __ret;
62839}
6381962840#endif
6382062841
6382162842#ifdef __LITTLE_ENDIAN__
63822#define vst4q_s64(__p0, __p1) __extension__ ({ \
63823 int64x2x4_t __s1 = __p1; \
63824 __builtin_neon_vst4q_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], 35); \
63825})
62843__ai __attribute__((target("bf16"))) bfloat16x8_t __a64_vcvtq_low_bf16_f32(float32x4_t __p0) {
62844 bfloat16x8_t __ret;
62845 __ret = (bfloat16x8_t) __builtin_neon___a64_vcvtq_low_bf16_f32((int8x16_t)__p0, 43);
62846 return __ret;
62847}
6382662848#else
63827#define vst4q_s64(__p0, __p1) __extension__ ({ \
63828 int64x2x4_t __s1 = __p1; \
63829 int64x2x4_t __rev1; \
63830 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63831 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63832 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
63833 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 1, 0); \
63834 __builtin_neon_vst4q_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], 35); \
63835})
62849__ai __attribute__((target("bf16"))) bfloat16x8_t __a64_vcvtq_low_bf16_f32(float32x4_t __p0) {
62850 bfloat16x8_t __ret;
62851 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
62852 __ret = (bfloat16x8_t) __builtin_neon___a64_vcvtq_low_bf16_f32((int8x16_t)__rev0, 43);
62853 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
62854 return __ret;
62855}
62856__ai __attribute__((target("bf16"))) bfloat16x8_t __noswap___a64_vcvtq_low_bf16_f32(float32x4_t __p0) {
62857 bfloat16x8_t __ret;
62858 __ret = (bfloat16x8_t) __builtin_neon___a64_vcvtq_low_bf16_f32((int8x16_t)__p0, 43);
62859 return __ret;
62860}
6383662861#endif
6383762862
63838#define vst4_f64(__p0, __p1) __extension__ ({ \
63839 float64x1x4_t __s1 = __p1; \
63840 __builtin_neon_vst4_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], 10); \
63841})
63842#define vst4_lane_p64(__p0, __p1, __p2) __extension__ ({ \
63843 poly64x1x4_t __s1 = __p1; \
63844 __builtin_neon_vst4_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], __p2, 6); \
63845})
6384662863#ifdef __LITTLE_ENDIAN__
63847#define vst4q_lane_p8(__p0, __p1, __p2) __extension__ ({ \
63848 poly8x16x4_t __s1 = __p1; \
63849 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 36); \
62864#define vcopyq_lane_bf16(__p0_739, __p1_739, __p2_739, __p3_739) __extension__ ({ \
62865 bfloat16x8_t __ret_739; \
62866 bfloat16x8_t __s0_739 = __p0_739; \
62867 bfloat16x4_t __s2_739 = __p2_739; \
62868 __ret_739 = vsetq_lane_bf16(vget_lane_bf16(__s2_739, __p3_739), __s0_739, __p1_739); \
62869 __ret_739; \
6385062870})
6385162871#else
63852#define vst4q_lane_p8(__p0, __p1, __p2) __extension__ ({ \
63853 poly8x16x4_t __s1 = __p1; \
63854 poly8x16x4_t __rev1; \
63855 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63856 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63857 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63858 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63859 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 36); \
62872#define vcopyq_lane_bf16(__p0_740, __p1_740, __p2_740, __p3_740) __extension__ ({ \
62873 bfloat16x8_t __ret_740; \
62874 bfloat16x8_t __s0_740 = __p0_740; \
62875 bfloat16x4_t __s2_740 = __p2_740; \
62876 bfloat16x8_t __rev0_740; __rev0_740 = __builtin_shufflevector(__s0_740, __s0_740, 7, 6, 5, 4, 3, 2, 1, 0); \
62877 bfloat16x4_t __rev2_740; __rev2_740 = __builtin_shufflevector(__s2_740, __s2_740, 3, 2, 1, 0); \
62878 __ret_740 = __noswap_vsetq_lane_bf16(__noswap_vget_lane_bf16(__rev2_740, __p3_740), __rev0_740, __p1_740); \
62879 __ret_740 = __builtin_shufflevector(__ret_740, __ret_740, 7, 6, 5, 4, 3, 2, 1, 0); \
62880 __ret_740; \
6386062881})
6386162882#endif
6386262883
6386362884#ifdef __LITTLE_ENDIAN__
63864#define vst4q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
63865 poly64x2x4_t __s1 = __p1; \
63866 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 38); \
62885#define vcopy_lane_bf16(__p0_741, __p1_741, __p2_741, __p3_741) __extension__ ({ \
62886 bfloat16x4_t __ret_741; \
62887 bfloat16x4_t __s0_741 = __p0_741; \
62888 bfloat16x4_t __s2_741 = __p2_741; \
62889 __ret_741 = vset_lane_bf16(vget_lane_bf16(__s2_741, __p3_741), __s0_741, __p1_741); \
62890 __ret_741; \
6386762891})
6386862892#else
63869#define vst4q_lane_p64(__p0, __p1, __p2) __extension__ ({ \
63870 poly64x2x4_t __s1 = __p1; \
63871 poly64x2x4_t __rev1; \
63872 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63873 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63874 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
63875 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 1, 0); \
63876 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 38); \
62893#define vcopy_lane_bf16(__p0_742, __p1_742, __p2_742, __p3_742) __extension__ ({ \
62894 bfloat16x4_t __ret_742; \
62895 bfloat16x4_t __s0_742 = __p0_742; \
62896 bfloat16x4_t __s2_742 = __p2_742; \
62897 bfloat16x4_t __rev0_742; __rev0_742 = __builtin_shufflevector(__s0_742, __s0_742, 3, 2, 1, 0); \
62898 bfloat16x4_t __rev2_742; __rev2_742 = __builtin_shufflevector(__s2_742, __s2_742, 3, 2, 1, 0); \
62899 __ret_742 = __noswap_vset_lane_bf16(__noswap_vget_lane_bf16(__rev2_742, __p3_742), __rev0_742, __p1_742); \
62900 __ret_742 = __builtin_shufflevector(__ret_742, __ret_742, 3, 2, 1, 0); \
62901 __ret_742; \
6387762902})
6387862903#endif
6387962904
6388062905#ifdef __LITTLE_ENDIAN__
63881#define vst4q_lane_u8(__p0, __p1, __p2) __extension__ ({ \
63882 uint8x16x4_t __s1 = __p1; \
63883 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 48); \
62906#define vcopyq_laneq_bf16(__p0_743, __p1_743, __p2_743, __p3_743) __extension__ ({ \
62907 bfloat16x8_t __ret_743; \
62908 bfloat16x8_t __s0_743 = __p0_743; \
62909 bfloat16x8_t __s2_743 = __p2_743; \
62910 __ret_743 = vsetq_lane_bf16(vgetq_lane_bf16(__s2_743, __p3_743), __s0_743, __p1_743); \
62911 __ret_743; \
6388462912})
6388562913#else
63886#define vst4q_lane_u8(__p0, __p1, __p2) __extension__ ({ \
63887 uint8x16x4_t __s1 = __p1; \
63888 uint8x16x4_t __rev1; \
63889 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63890 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63891 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63892 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63893 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 48); \
62914#define vcopyq_laneq_bf16(__p0_744, __p1_744, __p2_744, __p3_744) __extension__ ({ \
62915 bfloat16x8_t __ret_744; \
62916 bfloat16x8_t __s0_744 = __p0_744; \
62917 bfloat16x8_t __s2_744 = __p2_744; \
62918 bfloat16x8_t __rev0_744; __rev0_744 = __builtin_shufflevector(__s0_744, __s0_744, 7, 6, 5, 4, 3, 2, 1, 0); \
62919 bfloat16x8_t __rev2_744; __rev2_744 = __builtin_shufflevector(__s2_744, __s2_744, 7, 6, 5, 4, 3, 2, 1, 0); \
62920 __ret_744 = __noswap_vsetq_lane_bf16(__noswap_vgetq_lane_bf16(__rev2_744, __p3_744), __rev0_744, __p1_744); \
62921 __ret_744 = __builtin_shufflevector(__ret_744, __ret_744, 7, 6, 5, 4, 3, 2, 1, 0); \
62922 __ret_744; \
6389462923})
6389562924#endif
6389662925
6389762926#ifdef __LITTLE_ENDIAN__
63898#define vst4q_lane_u64(__p0, __p1, __p2) __extension__ ({ \
63899 uint64x2x4_t __s1 = __p1; \
63900 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 51); \
62927#define vcopy_laneq_bf16(__p0_745, __p1_745, __p2_745, __p3_745) __extension__ ({ \
62928 bfloat16x4_t __ret_745; \
62929 bfloat16x4_t __s0_745 = __p0_745; \
62930 bfloat16x8_t __s2_745 = __p2_745; \
62931 __ret_745 = vset_lane_bf16(vgetq_lane_bf16(__s2_745, __p3_745), __s0_745, __p1_745); \
62932 __ret_745; \
6390162933})
6390262934#else
63903#define vst4q_lane_u64(__p0, __p1, __p2) __extension__ ({ \
63904 uint64x2x4_t __s1 = __p1; \
63905 uint64x2x4_t __rev1; \
63906 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63907 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63908 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
63909 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 1, 0); \
63910 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 51); \
62935#define vcopy_laneq_bf16(__p0_746, __p1_746, __p2_746, __p3_746) __extension__ ({ \
62936 bfloat16x4_t __ret_746; \
62937 bfloat16x4_t __s0_746 = __p0_746; \
62938 bfloat16x8_t __s2_746 = __p2_746; \
62939 bfloat16x4_t __rev0_746; __rev0_746 = __builtin_shufflevector(__s0_746, __s0_746, 3, 2, 1, 0); \
62940 bfloat16x8_t __rev2_746; __rev2_746 = __builtin_shufflevector(__s2_746, __s2_746, 7, 6, 5, 4, 3, 2, 1, 0); \
62941 __ret_746 = __noswap_vset_lane_bf16(__noswap_vgetq_lane_bf16(__rev2_746, __p3_746), __rev0_746, __p1_746); \
62942 __ret_746 = __builtin_shufflevector(__ret_746, __ret_746, 3, 2, 1, 0); \
62943 __ret_746; \
6391162944})
6391262945#endif
6391362946
6391462947#ifdef __LITTLE_ENDIAN__
63915#define vst4q_lane_s8(__p0, __p1, __p2) __extension__ ({ \
63916 int8x16x4_t __s1 = __p1; \
63917 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 32); \
63918})
62948__ai __attribute__((target("bf16"))) bfloat16x4_t vcvt_bf16_f32(float32x4_t __p0) {
62949 bfloat16x4_t __ret;
62950 __ret = vget_low_bf16(__a64_vcvtq_low_bf16_f32(__p0));
62951 return __ret;
62952}
6391962953#else
63920#define vst4q_lane_s8(__p0, __p1, __p2) __extension__ ({ \
63921 int8x16x4_t __s1 = __p1; \
63922 int8x16x4_t __rev1; \
63923 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63924 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63925 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63926 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63927 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 32); \
63928})
62954__ai __attribute__((target("bf16"))) bfloat16x4_t vcvt_bf16_f32(float32x4_t __p0) {
62955 bfloat16x4_t __ret;
62956 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
62957 __ret = __noswap_vget_low_bf16(__noswap___a64_vcvtq_low_bf16_f32(__rev0));
62958 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
62959 return __ret;
62960}
6392962961#endif
6393062962
6393162963#ifdef __LITTLE_ENDIAN__
63932#define vst4q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
63933 float64x2x4_t __s1 = __p1; \
63934 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 42); \
63935})
62964__ai __attribute__((target("bf16"))) bfloat16x8_t vcvtq_high_bf16_f32(bfloat16x8_t __p0, float32x4_t __p1) {
62965 bfloat16x8_t __ret;
62966 __ret = (bfloat16x8_t) __builtin_neon_vcvtq_high_bf16_f32((int8x16_t)__p0, (int8x16_t)__p1, 43);
62967 return __ret;
62968}
6393662969#else
63937#define vst4q_lane_f64(__p0, __p1, __p2) __extension__ ({ \
63938 float64x2x4_t __s1 = __p1; \
63939 float64x2x4_t __rev1; \
63940 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63941 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63942 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
63943 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 1, 0); \
63944 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 42); \
63945})
62970__ai __attribute__((target("bf16"))) bfloat16x8_t vcvtq_high_bf16_f32(bfloat16x8_t __p0, float32x4_t __p1) {
62971 bfloat16x8_t __ret;
62972 bfloat16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
62973 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
62974 __ret = (bfloat16x8_t) __builtin_neon_vcvtq_high_bf16_f32((int8x16_t)__rev0, (int8x16_t)__rev1, 43);
62975 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
62976 return __ret;
62977}
6394662978#endif
6394762979
6394862980#ifdef __LITTLE_ENDIAN__
63949#define vst4q_lane_s64(__p0, __p1, __p2) __extension__ ({ \
63950 int64x2x4_t __s1 = __p1; \
63951 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__s1.val[0], (int8x16_t)__s1.val[1], (int8x16_t)__s1.val[2], (int8x16_t)__s1.val[3], __p2, 35); \
63952})
62981__ai __attribute__((target("bf16"))) bfloat16x8_t vcvtq_low_bf16_f32(float32x4_t __p0) {
62982 bfloat16x8_t __ret;
62983 __ret = __a64_vcvtq_low_bf16_f32(__p0);
62984 return __ret;
62985}
6395362986#else
63954#define vst4q_lane_s64(__p0, __p1, __p2) __extension__ ({ \
63955 int64x2x4_t __s1 = __p1; \
63956 int64x2x4_t __rev1; \
63957 __rev1.val[0] = __builtin_shufflevector(__s1.val[0], __s1.val[0], 1, 0); \
63958 __rev1.val[1] = __builtin_shufflevector(__s1.val[1], __s1.val[1], 1, 0); \
63959 __rev1.val[2] = __builtin_shufflevector(__s1.val[2], __s1.val[2], 1, 0); \
63960 __rev1.val[3] = __builtin_shufflevector(__s1.val[3], __s1.val[3], 1, 0); \
63961 __builtin_neon_vst4q_lane_v(__p0, (int8x16_t)__rev1.val[0], (int8x16_t)__rev1.val[1], (int8x16_t)__rev1.val[2], (int8x16_t)__rev1.val[3], __p2, 35); \
63962})
62987__ai __attribute__((target("bf16"))) bfloat16x8_t vcvtq_low_bf16_f32(float32x4_t __p0) {
62988 bfloat16x8_t __ret;
62989 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
62990 __ret = __noswap___a64_vcvtq_low_bf16_f32(__rev0);
62991 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
62992 return __ret;
62993}
6396362994#endif
6396462995
63965#define vst4_lane_u64(__p0, __p1, __p2) __extension__ ({ \
63966 uint64x1x4_t __s1 = __p1; \
63967 __builtin_neon_vst4_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], __p2, 19); \
63968})
63969#define vst4_lane_f64(__p0, __p1, __p2) __extension__ ({ \
63970 float64x1x4_t __s1 = __p1; \
63971 __builtin_neon_vst4_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], __p2, 10); \
63972})
63973#define vst4_lane_s64(__p0, __p1, __p2) __extension__ ({ \
63974 int64x1x4_t __s1 = __p1; \
63975 __builtin_neon_vst4_lane_v(__p0, (int8x8_t)__s1.val[0], (int8x8_t)__s1.val[1], (int8x8_t)__s1.val[2], (int8x8_t)__s1.val[3], __p2, 3); \
63976})
63977#define vstrq_p128(__p0, __p1) __extension__ ({ \
63978 poly128_t __s1 = __p1; \
63979 __builtin_neon_vstrq_p128(__p0, __s1); \
63980})
63981__ai uint64_t vsubd_u64(uint64_t __p0, uint64_t __p1) {
63982 uint64_t __ret;
63983 __ret = (uint64_t) __builtin_neon_vsubd_u64(__p0, __p1);
62996__ai __attribute__((target("bf16"))) poly8x8_t vreinterpret_p8_bf16(bfloat16x4_t __p0) {
62997 poly8x8_t __ret;
62998 __ret = (poly8x8_t)(__p0);
6398462999 return __ret;
6398563000}
63986__ai int64_t vsubd_s64(int64_t __p0, int64_t __p1) {
63987 int64_t __ret;
63988 __ret = (int64_t) __builtin_neon_vsubd_s64(__p0, __p1);
63001__ai __attribute__((target("bf16"))) poly64x1_t vreinterpret_p64_bf16(bfloat16x4_t __p0) {
63002 poly64x1_t __ret;
63003 __ret = (poly64x1_t)(__p0);
6398963004 return __ret;
6399063005}
63991#ifdef __LITTLE_ENDIAN__
63992__ai float64x2_t vsubq_f64(float64x2_t __p0, float64x2_t __p1) {
63993 float64x2_t __ret;
63994 __ret = __p0 - __p1;
63006__ai __attribute__((target("bf16"))) poly16x4_t vreinterpret_p16_bf16(bfloat16x4_t __p0) {
63007 poly16x4_t __ret;
63008 __ret = (poly16x4_t)(__p0);
6399563009 return __ret;
6399663010}
63997#else
63998__ai float64x2_t vsubq_f64(float64x2_t __p0, float64x2_t __p1) {
63011__ai __attribute__((target("bf16"))) poly8x16_t vreinterpretq_p8_bf16(bfloat16x8_t __p0) {
63012 poly8x16_t __ret;
63013 __ret = (poly8x16_t)(__p0);
63014 return __ret;
63015}
63016__ai __attribute__((target("bf16"))) poly128_t vreinterpretq_p128_bf16(bfloat16x8_t __p0) {
63017 poly128_t __ret;
63018 __ret = (poly128_t)(__p0);
63019 return __ret;
63020}
63021__ai __attribute__((target("bf16"))) poly64x2_t vreinterpretq_p64_bf16(bfloat16x8_t __p0) {
63022 poly64x2_t __ret;
63023 __ret = (poly64x2_t)(__p0);
63024 return __ret;
63025}
63026__ai __attribute__((target("bf16"))) poly16x8_t vreinterpretq_p16_bf16(bfloat16x8_t __p0) {
63027 poly16x8_t __ret;
63028 __ret = (poly16x8_t)(__p0);
63029 return __ret;
63030}
63031__ai __attribute__((target("bf16"))) uint8x16_t vreinterpretq_u8_bf16(bfloat16x8_t __p0) {
63032 uint8x16_t __ret;
63033 __ret = (uint8x16_t)(__p0);
63034 return __ret;
63035}
63036__ai __attribute__((target("bf16"))) uint32x4_t vreinterpretq_u32_bf16(bfloat16x8_t __p0) {
63037 uint32x4_t __ret;
63038 __ret = (uint32x4_t)(__p0);
63039 return __ret;
63040}
63041__ai __attribute__((target("bf16"))) uint64x2_t vreinterpretq_u64_bf16(bfloat16x8_t __p0) {
63042 uint64x2_t __ret;
63043 __ret = (uint64x2_t)(__p0);
63044 return __ret;
63045}
63046__ai __attribute__((target("bf16"))) uint16x8_t vreinterpretq_u16_bf16(bfloat16x8_t __p0) {
63047 uint16x8_t __ret;
63048 __ret = (uint16x8_t)(__p0);
63049 return __ret;
63050}
63051__ai __attribute__((target("bf16"))) int8x16_t vreinterpretq_s8_bf16(bfloat16x8_t __p0) {
63052 int8x16_t __ret;
63053 __ret = (int8x16_t)(__p0);
63054 return __ret;
63055}
63056__ai __attribute__((target("bf16"))) float64x2_t vreinterpretq_f64_bf16(bfloat16x8_t __p0) {
6399963057 float64x2_t __ret;
64000 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
64001 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
64002 __ret = __rev0 - __rev1;
64003 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
63058 __ret = (float64x2_t)(__p0);
6400463059 return __ret;
6400563060}
64006#endif
64007
64008__ai float64x1_t vsub_f64(float64x1_t __p0, float64x1_t __p1) {
63061__ai __attribute__((target("bf16"))) float32x4_t vreinterpretq_f32_bf16(bfloat16x8_t __p0) {
63062 float32x4_t __ret;
63063 __ret = (float32x4_t)(__p0);
63064 return __ret;
63065}
63066__ai __attribute__((target("bf16"))) float16x8_t vreinterpretq_f16_bf16(bfloat16x8_t __p0) {
63067 float16x8_t __ret;
63068 __ret = (float16x8_t)(__p0);
63069 return __ret;
63070}
63071__ai __attribute__((target("bf16"))) int32x4_t vreinterpretq_s32_bf16(bfloat16x8_t __p0) {
63072 int32x4_t __ret;
63073 __ret = (int32x4_t)(__p0);
63074 return __ret;
63075}
63076__ai __attribute__((target("bf16"))) int64x2_t vreinterpretq_s64_bf16(bfloat16x8_t __p0) {
63077 int64x2_t __ret;
63078 __ret = (int64x2_t)(__p0);
63079 return __ret;
63080}
63081__ai __attribute__((target("bf16"))) int16x8_t vreinterpretq_s16_bf16(bfloat16x8_t __p0) {
63082 int16x8_t __ret;
63083 __ret = (int16x8_t)(__p0);
63084 return __ret;
63085}
63086__ai __attribute__((target("bf16"))) uint8x8_t vreinterpret_u8_bf16(bfloat16x4_t __p0) {
63087 uint8x8_t __ret;
63088 __ret = (uint8x8_t)(__p0);
63089 return __ret;
63090}
63091__ai __attribute__((target("bf16"))) uint32x2_t vreinterpret_u32_bf16(bfloat16x4_t __p0) {
63092 uint32x2_t __ret;
63093 __ret = (uint32x2_t)(__p0);
63094 return __ret;
63095}
63096__ai __attribute__((target("bf16"))) uint64x1_t vreinterpret_u64_bf16(bfloat16x4_t __p0) {
63097 uint64x1_t __ret;
63098 __ret = (uint64x1_t)(__p0);
63099 return __ret;
63100}
63101__ai __attribute__((target("bf16"))) uint16x4_t vreinterpret_u16_bf16(bfloat16x4_t __p0) {
63102 uint16x4_t __ret;
63103 __ret = (uint16x4_t)(__p0);
63104 return __ret;
63105}
63106__ai __attribute__((target("bf16"))) int8x8_t vreinterpret_s8_bf16(bfloat16x4_t __p0) {
63107 int8x8_t __ret;
63108 __ret = (int8x8_t)(__p0);
63109 return __ret;
63110}
63111__ai __attribute__((target("bf16"))) float64x1_t vreinterpret_f64_bf16(bfloat16x4_t __p0) {
6400963112 float64x1_t __ret;
64010 __ret = __p0 - __p1;
63113 __ret = (float64x1_t)(__p0);
6401163114 return __ret;
6401263115}
64013#ifdef __LITTLE_ENDIAN__
64014__ai uint16x8_t vsubhn_high_u32(uint16x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
64015 uint16x8_t __ret;
64016 __ret = vcombine_u16(__p0, vsubhn_u32(__p1, __p2));
63116__ai __attribute__((target("bf16"))) float32x2_t vreinterpret_f32_bf16(bfloat16x4_t __p0) {
63117 float32x2_t __ret;
63118 __ret = (float32x2_t)(__p0);
6401763119 return __ret;
6401863120}
64019#else
64020__ai uint16x8_t vsubhn_high_u32(uint16x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
64021 uint16x8_t __ret;
64022 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
64023 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
64024 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
64025 __ret = __noswap_vcombine_u16(__rev0, __noswap_vsubhn_u32(__rev1, __rev2));
64026 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
63121__ai __attribute__((target("bf16"))) float16x4_t vreinterpret_f16_bf16(bfloat16x4_t __p0) {
63122 float16x4_t __ret;
63123 __ret = (float16x4_t)(__p0);
6402763124 return __ret;
6402863125}
64029#endif
64030
64031#ifdef __LITTLE_ENDIAN__
64032__ai uint32x4_t vsubhn_high_u64(uint32x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
64033 uint32x4_t __ret;
64034 __ret = vcombine_u32(__p0, vsubhn_u64(__p1, __p2));
63126__ai __attribute__((target("bf16"))) int32x2_t vreinterpret_s32_bf16(bfloat16x4_t __p0) {
63127 int32x2_t __ret;
63128 __ret = (int32x2_t)(__p0);
6403563129 return __ret;
6403663130}
64037#else
64038__ai uint32x4_t vsubhn_high_u64(uint32x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
64039 uint32x4_t __ret;
64040 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
64041 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
64042 uint64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
64043 __ret = __noswap_vcombine_u32(__rev0, __noswap_vsubhn_u64(__rev1, __rev2));
64044 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
63131__ai __attribute__((target("bf16"))) int64x1_t vreinterpret_s64_bf16(bfloat16x4_t __p0) {
63132 int64x1_t __ret;
63133 __ret = (int64x1_t)(__p0);
63134 return __ret;
63135}
63136__ai __attribute__((target("bf16"))) int16x4_t vreinterpret_s16_bf16(bfloat16x4_t __p0) {
63137 int16x4_t __ret;
63138 __ret = (int16x4_t)(__p0);
63139 return __ret;
63140}
63141__ai __attribute__((target("bf16"))) bfloat16x8_t vreinterpretq_bf16_p8(poly8x16_t __p0) {
63142 bfloat16x8_t __ret;
63143 __ret = (bfloat16x8_t)(__p0);
63144 return __ret;
63145}
63146__ai __attribute__((target("bf16"))) bfloat16x8_t vreinterpretq_bf16_p128(poly128_t __p0) {
63147 bfloat16x8_t __ret;
63148 __ret = (bfloat16x8_t)(__p0);
63149 return __ret;
63150}
63151__ai __attribute__((target("bf16"))) bfloat16x8_t vreinterpretq_bf16_p64(poly64x2_t __p0) {
63152 bfloat16x8_t __ret;
63153 __ret = (bfloat16x8_t)(__p0);
63154 return __ret;
63155}
63156__ai __attribute__((target("bf16"))) bfloat16x8_t vreinterpretq_bf16_p16(poly16x8_t __p0) {
63157 bfloat16x8_t __ret;
63158 __ret = (bfloat16x8_t)(__p0);
63159 return __ret;
63160}
63161__ai __attribute__((target("bf16"))) bfloat16x8_t vreinterpretq_bf16_u8(uint8x16_t __p0) {
63162 bfloat16x8_t __ret;
63163 __ret = (bfloat16x8_t)(__p0);
63164 return __ret;
63165}
63166__ai __attribute__((target("bf16"))) bfloat16x8_t vreinterpretq_bf16_u32(uint32x4_t __p0) {
63167 bfloat16x8_t __ret;
63168 __ret = (bfloat16x8_t)(__p0);
63169 return __ret;
63170}
63171__ai __attribute__((target("bf16"))) bfloat16x8_t vreinterpretq_bf16_u64(uint64x2_t __p0) {
63172 bfloat16x8_t __ret;
63173 __ret = (bfloat16x8_t)(__p0);
63174 return __ret;
63175}
63176__ai __attribute__((target("bf16"))) bfloat16x8_t vreinterpretq_bf16_u16(uint16x8_t __p0) {
63177 bfloat16x8_t __ret;
63178 __ret = (bfloat16x8_t)(__p0);
63179 return __ret;
63180}
63181__ai __attribute__((target("bf16"))) bfloat16x8_t vreinterpretq_bf16_s8(int8x16_t __p0) {
63182 bfloat16x8_t __ret;
63183 __ret = (bfloat16x8_t)(__p0);
63184 return __ret;
63185}
63186__ai __attribute__((target("bf16"))) bfloat16x8_t vreinterpretq_bf16_f64(float64x2_t __p0) {
63187 bfloat16x8_t __ret;
63188 __ret = (bfloat16x8_t)(__p0);
63189 return __ret;
63190}
63191__ai __attribute__((target("bf16"))) bfloat16x8_t vreinterpretq_bf16_f32(float32x4_t __p0) {
63192 bfloat16x8_t __ret;
63193 __ret = (bfloat16x8_t)(__p0);
63194 return __ret;
63195}
63196__ai __attribute__((target("bf16"))) bfloat16x8_t vreinterpretq_bf16_f16(float16x8_t __p0) {
63197 bfloat16x8_t __ret;
63198 __ret = (bfloat16x8_t)(__p0);
63199 return __ret;
63200}
63201__ai __attribute__((target("bf16"))) bfloat16x8_t vreinterpretq_bf16_s32(int32x4_t __p0) {
63202 bfloat16x8_t __ret;
63203 __ret = (bfloat16x8_t)(__p0);
63204 return __ret;
63205}
63206__ai __attribute__((target("bf16"))) bfloat16x8_t vreinterpretq_bf16_s64(int64x2_t __p0) {
63207 bfloat16x8_t __ret;
63208 __ret = (bfloat16x8_t)(__p0);
63209 return __ret;
63210}
63211__ai __attribute__((target("bf16"))) bfloat16x8_t vreinterpretq_bf16_s16(int16x8_t __p0) {
63212 bfloat16x8_t __ret;
63213 __ret = (bfloat16x8_t)(__p0);
63214 return __ret;
63215}
63216__ai __attribute__((target("bf16"))) bfloat16x4_t vreinterpret_bf16_p8(poly8x8_t __p0) {
63217 bfloat16x4_t __ret;
63218 __ret = (bfloat16x4_t)(__p0);
63219 return __ret;
63220}
63221__ai __attribute__((target("bf16"))) bfloat16x4_t vreinterpret_bf16_p64(poly64x1_t __p0) {
63222 bfloat16x4_t __ret;
63223 __ret = (bfloat16x4_t)(__p0);
63224 return __ret;
63225}
63226__ai __attribute__((target("bf16"))) bfloat16x4_t vreinterpret_bf16_p16(poly16x4_t __p0) {
63227 bfloat16x4_t __ret;
63228 __ret = (bfloat16x4_t)(__p0);
63229 return __ret;
63230}
63231__ai __attribute__((target("bf16"))) bfloat16x4_t vreinterpret_bf16_u8(uint8x8_t __p0) {
63232 bfloat16x4_t __ret;
63233 __ret = (bfloat16x4_t)(__p0);
63234 return __ret;
63235}
63236__ai __attribute__((target("bf16"))) bfloat16x4_t vreinterpret_bf16_u32(uint32x2_t __p0) {
63237 bfloat16x4_t __ret;
63238 __ret = (bfloat16x4_t)(__p0);
63239 return __ret;
63240}
63241__ai __attribute__((target("bf16"))) bfloat16x4_t vreinterpret_bf16_u64(uint64x1_t __p0) {
63242 bfloat16x4_t __ret;
63243 __ret = (bfloat16x4_t)(__p0);
63244 return __ret;
63245}
63246__ai __attribute__((target("bf16"))) bfloat16x4_t vreinterpret_bf16_u16(uint16x4_t __p0) {
63247 bfloat16x4_t __ret;
63248 __ret = (bfloat16x4_t)(__p0);
63249 return __ret;
63250}
63251__ai __attribute__((target("bf16"))) bfloat16x4_t vreinterpret_bf16_s8(int8x8_t __p0) {
63252 bfloat16x4_t __ret;
63253 __ret = (bfloat16x4_t)(__p0);
63254 return __ret;
63255}
63256__ai __attribute__((target("bf16"))) bfloat16x4_t vreinterpret_bf16_f64(float64x1_t __p0) {
63257 bfloat16x4_t __ret;
63258 __ret = (bfloat16x4_t)(__p0);
63259 return __ret;
63260}
63261__ai __attribute__((target("bf16"))) bfloat16x4_t vreinterpret_bf16_f32(float32x2_t __p0) {
63262 bfloat16x4_t __ret;
63263 __ret = (bfloat16x4_t)(__p0);
63264 return __ret;
63265}
63266__ai __attribute__((target("bf16"))) bfloat16x4_t vreinterpret_bf16_f16(float16x4_t __p0) {
63267 bfloat16x4_t __ret;
63268 __ret = (bfloat16x4_t)(__p0);
63269 return __ret;
63270}
63271__ai __attribute__((target("bf16"))) bfloat16x4_t vreinterpret_bf16_s32(int32x2_t __p0) {
63272 bfloat16x4_t __ret;
63273 __ret = (bfloat16x4_t)(__p0);
63274 return __ret;
63275}
63276__ai __attribute__((target("bf16"))) bfloat16x4_t vreinterpret_bf16_s64(int64x1_t __p0) {
63277 bfloat16x4_t __ret;
63278 __ret = (bfloat16x4_t)(__p0);
63279 return __ret;
63280}
63281__ai __attribute__((target("bf16"))) bfloat16x4_t vreinterpret_bf16_s16(int16x4_t __p0) {
63282 bfloat16x4_t __ret;
63283 __ret = (bfloat16x4_t)(__p0);
6404563284 return __ret;
6404663285}
63286#ifdef __LITTLE_ENDIAN__
63287#define vdotq_laneq_u32(__p0_747, __p1_747, __p2_747, __p3_747) __extension__ ({ \
63288 uint32x4_t __ret_747; \
63289 uint32x4_t __s0_747 = __p0_747; \
63290 uint8x16_t __s1_747 = __p1_747; \
63291 uint8x16_t __s2_747 = __p2_747; \
63292uint8x16_t __reint_747 = __s2_747; \
63293uint32x4_t __reint1_747 = splatq_laneq_u32(*(uint32x4_t *) &__reint_747, __p3_747); \
63294 __ret_747 = vdotq_u32(__s0_747, __s1_747, *(uint8x16_t *) &__reint1_747); \
63295 __ret_747; \
63296})
63297#else
63298#define vdotq_laneq_u32(__p0_748, __p1_748, __p2_748, __p3_748) __extension__ ({ \
63299 uint32x4_t __ret_748; \
63300 uint32x4_t __s0_748 = __p0_748; \
63301 uint8x16_t __s1_748 = __p1_748; \
63302 uint8x16_t __s2_748 = __p2_748; \
63303 uint32x4_t __rev0_748; __rev0_748 = __builtin_shufflevector(__s0_748, __s0_748, 3, 2, 1, 0); \
63304 uint8x16_t __rev1_748; __rev1_748 = __builtin_shufflevector(__s1_748, __s1_748, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63305 uint8x16_t __rev2_748; __rev2_748 = __builtin_shufflevector(__s2_748, __s2_748, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63306uint8x16_t __reint_748 = __rev2_748; \
63307uint32x4_t __reint1_748 = __noswap_splatq_laneq_u32(*(uint32x4_t *) &__reint_748, __p3_748); \
63308 __ret_748 = __noswap_vdotq_u32(__rev0_748, __rev1_748, *(uint8x16_t *) &__reint1_748); \
63309 __ret_748 = __builtin_shufflevector(__ret_748, __ret_748, 3, 2, 1, 0); \
63310 __ret_748; \
63311})
6404763312#endif
6404863313
6404963314#ifdef __LITTLE_ENDIAN__
64050__ai uint8x16_t vsubhn_high_u16(uint8x8_t __p0, uint16x8_t __p1, uint16x8_t __p2) {
64051 uint8x16_t __ret;
64052 __ret = vcombine_u8(__p0, vsubhn_u16(__p1, __p2));
64053 return __ret;
64054}
63315#define vdotq_laneq_s32(__p0_749, __p1_749, __p2_749, __p3_749) __extension__ ({ \
63316 int32x4_t __ret_749; \
63317 int32x4_t __s0_749 = __p0_749; \
63318 int8x16_t __s1_749 = __p1_749; \
63319 int8x16_t __s2_749 = __p2_749; \
63320int8x16_t __reint_749 = __s2_749; \
63321int32x4_t __reint1_749 = splatq_laneq_s32(*(int32x4_t *) &__reint_749, __p3_749); \
63322 __ret_749 = vdotq_s32(__s0_749, __s1_749, *(int8x16_t *) &__reint1_749); \
63323 __ret_749; \
63324})
63325#else
63326#define vdotq_laneq_s32(__p0_750, __p1_750, __p2_750, __p3_750) __extension__ ({ \
63327 int32x4_t __ret_750; \
63328 int32x4_t __s0_750 = __p0_750; \
63329 int8x16_t __s1_750 = __p1_750; \
63330 int8x16_t __s2_750 = __p2_750; \
63331 int32x4_t __rev0_750; __rev0_750 = __builtin_shufflevector(__s0_750, __s0_750, 3, 2, 1, 0); \
63332 int8x16_t __rev1_750; __rev1_750 = __builtin_shufflevector(__s1_750, __s1_750, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63333 int8x16_t __rev2_750; __rev2_750 = __builtin_shufflevector(__s2_750, __s2_750, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63334int8x16_t __reint_750 = __rev2_750; \
63335int32x4_t __reint1_750 = __noswap_splatq_laneq_s32(*(int32x4_t *) &__reint_750, __p3_750); \
63336 __ret_750 = __noswap_vdotq_s32(__rev0_750, __rev1_750, *(int8x16_t *) &__reint1_750); \
63337 __ret_750 = __builtin_shufflevector(__ret_750, __ret_750, 3, 2, 1, 0); \
63338 __ret_750; \
63339})
63340#endif
63341
63342#ifdef __LITTLE_ENDIAN__
63343#define vdot_laneq_u32(__p0_751, __p1_751, __p2_751, __p3_751) __extension__ ({ \
63344 uint32x2_t __ret_751; \
63345 uint32x2_t __s0_751 = __p0_751; \
63346 uint8x8_t __s1_751 = __p1_751; \
63347 uint8x16_t __s2_751 = __p2_751; \
63348uint8x16_t __reint_751 = __s2_751; \
63349uint32x2_t __reint1_751 = splat_laneq_u32(*(uint32x4_t *) &__reint_751, __p3_751); \
63350 __ret_751 = vdot_u32(__s0_751, __s1_751, *(uint8x8_t *) &__reint1_751); \
63351 __ret_751; \
63352})
6405563353#else
64056__ai uint8x16_t vsubhn_high_u16(uint8x8_t __p0, uint16x8_t __p1, uint16x8_t __p2) {
64057 uint8x16_t __ret;
64058 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64059 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
64060 uint16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
64061 __ret = __noswap_vcombine_u8(__rev0, __noswap_vsubhn_u16(__rev1, __rev2));
64062 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
64063 return __ret;
64064}
63354#define vdot_laneq_u32(__p0_752, __p1_752, __p2_752, __p3_752) __extension__ ({ \
63355 uint32x2_t __ret_752; \
63356 uint32x2_t __s0_752 = __p0_752; \
63357 uint8x8_t __s1_752 = __p1_752; \
63358 uint8x16_t __s2_752 = __p2_752; \
63359 uint32x2_t __rev0_752; __rev0_752 = __builtin_shufflevector(__s0_752, __s0_752, 1, 0); \
63360 uint8x8_t __rev1_752; __rev1_752 = __builtin_shufflevector(__s1_752, __s1_752, 7, 6, 5, 4, 3, 2, 1, 0); \
63361 uint8x16_t __rev2_752; __rev2_752 = __builtin_shufflevector(__s2_752, __s2_752, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63362uint8x16_t __reint_752 = __rev2_752; \
63363uint32x2_t __reint1_752 = __noswap_splat_laneq_u32(*(uint32x4_t *) &__reint_752, __p3_752); \
63364 __ret_752 = __noswap_vdot_u32(__rev0_752, __rev1_752, *(uint8x8_t *) &__reint1_752); \
63365 __ret_752 = __builtin_shufflevector(__ret_752, __ret_752, 1, 0); \
63366 __ret_752; \
63367})
6406563368#endif
6406663369
6406763370#ifdef __LITTLE_ENDIAN__
64068__ai int16x8_t vsubhn_high_s32(int16x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
64069 int16x8_t __ret;
64070 __ret = vcombine_s16(__p0, vsubhn_s32(__p1, __p2));
64071 return __ret;
64072}
63371#define vdot_laneq_s32(__p0_753, __p1_753, __p2_753, __p3_753) __extension__ ({ \
63372 int32x2_t __ret_753; \
63373 int32x2_t __s0_753 = __p0_753; \
63374 int8x8_t __s1_753 = __p1_753; \
63375 int8x16_t __s2_753 = __p2_753; \
63376int8x16_t __reint_753 = __s2_753; \
63377int32x2_t __reint1_753 = splat_laneq_s32(*(int32x4_t *) &__reint_753, __p3_753); \
63378 __ret_753 = vdot_s32(__s0_753, __s1_753, *(int8x8_t *) &__reint1_753); \
63379 __ret_753; \
63380})
6407363381#else
64074__ai int16x8_t vsubhn_high_s32(int16x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
64075 int16x8_t __ret;
64076 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
64077 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
64078 int32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
64079 __ret = __noswap_vcombine_s16(__rev0, __noswap_vsubhn_s32(__rev1, __rev2));
64080 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
64081 return __ret;
64082}
63382#define vdot_laneq_s32(__p0_754, __p1_754, __p2_754, __p3_754) __extension__ ({ \
63383 int32x2_t __ret_754; \
63384 int32x2_t __s0_754 = __p0_754; \
63385 int8x8_t __s1_754 = __p1_754; \
63386 int8x16_t __s2_754 = __p2_754; \
63387 int32x2_t __rev0_754; __rev0_754 = __builtin_shufflevector(__s0_754, __s0_754, 1, 0); \
63388 int8x8_t __rev1_754; __rev1_754 = __builtin_shufflevector(__s1_754, __s1_754, 7, 6, 5, 4, 3, 2, 1, 0); \
63389 int8x16_t __rev2_754; __rev2_754 = __builtin_shufflevector(__s2_754, __s2_754, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
63390int8x16_t __reint_754 = __rev2_754; \
63391int32x2_t __reint1_754 = __noswap_splat_laneq_s32(*(int32x4_t *) &__reint_754, __p3_754); \
63392 __ret_754 = __noswap_vdot_s32(__rev0_754, __rev1_754, *(int8x8_t *) &__reint1_754); \
63393 __ret_754 = __builtin_shufflevector(__ret_754, __ret_754, 1, 0); \
63394 __ret_754; \
63395})
6408363396#endif
6408463397
6408563398#ifdef __LITTLE_ENDIAN__
64086__ai int32x4_t vsubhn_high_s64(int32x2_t __p0, int64x2_t __p1, int64x2_t __p2) {
64087 int32x4_t __ret;
64088 __ret = vcombine_s32(__p0, vsubhn_s64(__p1, __p2));
63399__ai __attribute__((target("fp16fml"))) float32x4_t vfmlalq_high_f16(float32x4_t __p0, float16x8_t __p1, float16x8_t __p2) {
63400 float32x4_t __ret;
63401 __ret = (float32x4_t) __builtin_neon_vfmlalq_high_f16((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
6408963402 return __ret;
6409063403}
6409163404#else
64092__ai int32x4_t vsubhn_high_s64(int32x2_t __p0, int64x2_t __p1, int64x2_t __p2) {
64093 int32x4_t __ret;
64094 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
64095 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
64096 int64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
64097 __ret = __noswap_vcombine_s32(__rev0, __noswap_vsubhn_s64(__rev1, __rev2));
63405__ai __attribute__((target("fp16fml"))) float32x4_t vfmlalq_high_f16(float32x4_t __p0, float16x8_t __p1, float16x8_t __p2) {
63406 float32x4_t __ret;
63407 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
63408 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
63409 float16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
63410 __ret = (float32x4_t) __builtin_neon_vfmlalq_high_f16((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 41);
6409863411 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6409963412 return __ret;
6410063413}
63414__ai __attribute__((target("fp16fml"))) float32x4_t __noswap_vfmlalq_high_f16(float32x4_t __p0, float16x8_t __p1, float16x8_t __p2) {
63415 float32x4_t __ret;
63416 __ret = (float32x4_t) __builtin_neon_vfmlalq_high_f16((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
63417 return __ret;
63418}
6410163419#endif
6410263420
6410363421#ifdef __LITTLE_ENDIAN__
64104__ai int8x16_t vsubhn_high_s16(int8x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
64105 int8x16_t __ret;
64106 __ret = vcombine_s8(__p0, vsubhn_s16(__p1, __p2));
63422__ai __attribute__((target("fp16fml"))) float32x2_t vfmlal_high_f16(float32x2_t __p0, float16x4_t __p1, float16x4_t __p2) {
63423 float32x2_t __ret;
63424 __ret = (float32x2_t) __builtin_neon_vfmlal_high_f16((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
6410763425 return __ret;
6410863426}
6410963427#else
64110__ai int8x16_t vsubhn_high_s16(int8x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
64111 int8x16_t __ret;
64112 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64113 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
64114 int16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
64115 __ret = __noswap_vcombine_s8(__rev0, __noswap_vsubhn_s16(__rev1, __rev2));
64116 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
63428__ai __attribute__((target("fp16fml"))) float32x2_t vfmlal_high_f16(float32x2_t __p0, float16x4_t __p1, float16x4_t __p2) {
63429 float32x2_t __ret;
63430 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
63431 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
63432 float16x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
63433 __ret = (float32x2_t) __builtin_neon_vfmlal_high_f16((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 9);
63434 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
63435 return __ret;
63436}
63437__ai __attribute__((target("fp16fml"))) float32x2_t __noswap_vfmlal_high_f16(float32x2_t __p0, float16x4_t __p1, float16x4_t __p2) {
63438 float32x2_t __ret;
63439 __ret = (float32x2_t) __builtin_neon_vfmlal_high_f16((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
6411763440 return __ret;
6411863441}
6411963442#endif
6412063443
6412163444#ifdef __LITTLE_ENDIAN__
64122__ai uint16x8_t vsubl_high_u8(uint8x16_t __p0, uint8x16_t __p1) {
64123 uint16x8_t __ret;
64124 __ret = vmovl_high_u8(__p0) - vmovl_high_u8(__p1);
63445__ai __attribute__((target("fp16fml"))) float32x4_t vfmlalq_low_f16(float32x4_t __p0, float16x8_t __p1, float16x8_t __p2) {
63446 float32x4_t __ret;
63447 __ret = (float32x4_t) __builtin_neon_vfmlalq_low_f16((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
6412563448 return __ret;
6412663449}
6412763450#else
64128__ai uint16x8_t vsubl_high_u8(uint8x16_t __p0, uint8x16_t __p1) {
64129 uint16x8_t __ret;
64130 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
64131 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
64132 __ret = __noswap_vmovl_high_u8(__rev0) - __noswap_vmovl_high_u8(__rev1);
64133 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
63451__ai __attribute__((target("fp16fml"))) float32x4_t vfmlalq_low_f16(float32x4_t __p0, float16x8_t __p1, float16x8_t __p2) {
63452 float32x4_t __ret;
63453 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
63454 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
63455 float16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
63456 __ret = (float32x4_t) __builtin_neon_vfmlalq_low_f16((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 41);
63457 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
63458 return __ret;
63459}
63460__ai __attribute__((target("fp16fml"))) float32x4_t __noswap_vfmlalq_low_f16(float32x4_t __p0, float16x8_t __p1, float16x8_t __p2) {
63461 float32x4_t __ret;
63462 __ret = (float32x4_t) __builtin_neon_vfmlalq_low_f16((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
6413463463 return __ret;
6413563464}
6413663465#endif
6413763466
6413863467#ifdef __LITTLE_ENDIAN__
64139__ai uint64x2_t vsubl_high_u32(uint32x4_t __p0, uint32x4_t __p1) {
64140 uint64x2_t __ret;
64141 __ret = vmovl_high_u32(__p0) - vmovl_high_u32(__p1);
63468__ai __attribute__((target("fp16fml"))) float32x2_t vfmlal_low_f16(float32x2_t __p0, float16x4_t __p1, float16x4_t __p2) {
63469 float32x2_t __ret;
63470 __ret = (float32x2_t) __builtin_neon_vfmlal_low_f16((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
6414263471 return __ret;
6414363472}
6414463473#else
64145__ai uint64x2_t vsubl_high_u32(uint32x4_t __p0, uint32x4_t __p1) {
64146 uint64x2_t __ret;
64147 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
64148 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
64149 __ret = __noswap_vmovl_high_u32(__rev0) - __noswap_vmovl_high_u32(__rev1);
63474__ai __attribute__((target("fp16fml"))) float32x2_t vfmlal_low_f16(float32x2_t __p0, float16x4_t __p1, float16x4_t __p2) {
63475 float32x2_t __ret;
63476 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
63477 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
63478 float16x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
63479 __ret = (float32x2_t) __builtin_neon_vfmlal_low_f16((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 9);
6415063480 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6415163481 return __ret;
6415263482}
63483__ai __attribute__((target("fp16fml"))) float32x2_t __noswap_vfmlal_low_f16(float32x2_t __p0, float16x4_t __p1, float16x4_t __p2) {
63484 float32x2_t __ret;
63485 __ret = (float32x2_t) __builtin_neon_vfmlal_low_f16((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
63486 return __ret;
63487}
6415363488#endif
6415463489
6415563490#ifdef __LITTLE_ENDIAN__
64156__ai uint32x4_t vsubl_high_u16(uint16x8_t __p0, uint16x8_t __p1) {
64157 uint32x4_t __ret;
64158 __ret = vmovl_high_u16(__p0) - vmovl_high_u16(__p1);
63491__ai __attribute__((target("fp16fml"))) float32x4_t vfmlslq_high_f16(float32x4_t __p0, float16x8_t __p1, float16x8_t __p2) {
63492 float32x4_t __ret;
63493 __ret = (float32x4_t) __builtin_neon_vfmlslq_high_f16((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
6415963494 return __ret;
6416063495}
6416163496#else
64162__ai uint32x4_t vsubl_high_u16(uint16x8_t __p0, uint16x8_t __p1) {
64163 uint32x4_t __ret;
64164 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64165 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
64166 __ret = __noswap_vmovl_high_u16(__rev0) - __noswap_vmovl_high_u16(__rev1);
63497__ai __attribute__((target("fp16fml"))) float32x4_t vfmlslq_high_f16(float32x4_t __p0, float16x8_t __p1, float16x8_t __p2) {
63498 float32x4_t __ret;
63499 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
63500 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
63501 float16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
63502 __ret = (float32x4_t) __builtin_neon_vfmlslq_high_f16((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 41);
6416763503 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6416863504 return __ret;
6416963505}
64170#endif
64171
64172#ifdef __LITTLE_ENDIAN__
64173__ai int16x8_t vsubl_high_s8(int8x16_t __p0, int8x16_t __p1) {
64174 int16x8_t __ret;
64175 __ret = vmovl_high_s8(__p0) - vmovl_high_s8(__p1);
64176 return __ret;
64177}
64178#else
64179__ai int16x8_t vsubl_high_s8(int8x16_t __p0, int8x16_t __p1) {
64180 int16x8_t __ret;
64181 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
64182 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
64183 __ret = __noswap_vmovl_high_s8(__rev0) - __noswap_vmovl_high_s8(__rev1);
64184 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
63506__ai __attribute__((target("fp16fml"))) float32x4_t __noswap_vfmlslq_high_f16(float32x4_t __p0, float16x8_t __p1, float16x8_t __p2) {
63507 float32x4_t __ret;
63508 __ret = (float32x4_t) __builtin_neon_vfmlslq_high_f16((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
6418563509 return __ret;
6418663510}
6418763511#endif
6418863512
6418963513#ifdef __LITTLE_ENDIAN__
64190__ai int64x2_t vsubl_high_s32(int32x4_t __p0, int32x4_t __p1) {
64191 int64x2_t __ret;
64192 __ret = vmovl_high_s32(__p0) - vmovl_high_s32(__p1);
63514__ai __attribute__((target("fp16fml"))) float32x2_t vfmlsl_high_f16(float32x2_t __p0, float16x4_t __p1, float16x4_t __p2) {
63515 float32x2_t __ret;
63516 __ret = (float32x2_t) __builtin_neon_vfmlsl_high_f16((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
6419363517 return __ret;
6419463518}
6419563519#else
64196__ai int64x2_t vsubl_high_s32(int32x4_t __p0, int32x4_t __p1) {
64197 int64x2_t __ret;
64198 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
64199 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
64200 __ret = __noswap_vmovl_high_s32(__rev0) - __noswap_vmovl_high_s32(__rev1);
63520__ai __attribute__((target("fp16fml"))) float32x2_t vfmlsl_high_f16(float32x2_t __p0, float16x4_t __p1, float16x4_t __p2) {
63521 float32x2_t __ret;
63522 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
63523 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
63524 float16x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
63525 __ret = (float32x2_t) __builtin_neon_vfmlsl_high_f16((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 9);
6420163526 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6420263527 return __ret;
6420363528}
63529__ai __attribute__((target("fp16fml"))) float32x2_t __noswap_vfmlsl_high_f16(float32x2_t __p0, float16x4_t __p1, float16x4_t __p2) {
63530 float32x2_t __ret;
63531 __ret = (float32x2_t) __builtin_neon_vfmlsl_high_f16((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
63532 return __ret;
63533}
6420463534#endif
6420563535
6420663536#ifdef __LITTLE_ENDIAN__
64207__ai int32x4_t vsubl_high_s16(int16x8_t __p0, int16x8_t __p1) {
64208 int32x4_t __ret;
64209 __ret = vmovl_high_s16(__p0) - vmovl_high_s16(__p1);
63537__ai __attribute__((target("fp16fml"))) float32x4_t vfmlslq_low_f16(float32x4_t __p0, float16x8_t __p1, float16x8_t __p2) {
63538 float32x4_t __ret;
63539 __ret = (float32x4_t) __builtin_neon_vfmlslq_low_f16((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
6421063540 return __ret;
6421163541}
6421263542#else
64213__ai int32x4_t vsubl_high_s16(int16x8_t __p0, int16x8_t __p1) {
64214 int32x4_t __ret;
64215 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64216 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
64217 __ret = __noswap_vmovl_high_s16(__rev0) - __noswap_vmovl_high_s16(__rev1);
63543__ai __attribute__((target("fp16fml"))) float32x4_t vfmlslq_low_f16(float32x4_t __p0, float16x8_t __p1, float16x8_t __p2) {
63544 float32x4_t __ret;
63545 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
63546 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
63547 float16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
63548 __ret = (float32x4_t) __builtin_neon_vfmlslq_low_f16((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 41);
6421863549 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6421963550 return __ret;
6422063551}
63552__ai __attribute__((target("fp16fml"))) float32x4_t __noswap_vfmlslq_low_f16(float32x4_t __p0, float16x8_t __p1, float16x8_t __p2) {
63553 float32x4_t __ret;
63554 __ret = (float32x4_t) __builtin_neon_vfmlslq_low_f16((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 41);
63555 return __ret;
63556}
6422163557#endif
6422263558
6422363559#ifdef __LITTLE_ENDIAN__
64224__ai uint16x8_t vsubw_high_u8(uint16x8_t __p0, uint8x16_t __p1) {
64225 uint16x8_t __ret;
64226 __ret = __p0 - vmovl_high_u8(__p1);
63560__ai __attribute__((target("fp16fml"))) float32x2_t vfmlsl_low_f16(float32x2_t __p0, float16x4_t __p1, float16x4_t __p2) {
63561 float32x2_t __ret;
63562 __ret = (float32x2_t) __builtin_neon_vfmlsl_low_f16((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
6422763563 return __ret;
6422863564}
6422963565#else
64230__ai uint16x8_t vsubw_high_u8(uint16x8_t __p0, uint8x16_t __p1) {
64231 uint16x8_t __ret;
64232 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64233 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
64234 __ret = __rev0 - __noswap_vmovl_high_u8(__rev1);
64235 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
63566__ai __attribute__((target("fp16fml"))) float32x2_t vfmlsl_low_f16(float32x2_t __p0, float16x4_t __p1, float16x4_t __p2) {
63567 float32x2_t __ret;
63568 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
63569 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
63570 float16x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
63571 __ret = (float32x2_t) __builtin_neon_vfmlsl_low_f16((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, 9);
63572 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
63573 return __ret;
63574}
63575__ai __attribute__((target("fp16fml"))) float32x2_t __noswap_vfmlsl_low_f16(float32x2_t __p0, float16x4_t __p1, float16x4_t __p2) {
63576 float32x2_t __ret;
63577 __ret = (float32x2_t) __builtin_neon_vfmlsl_low_f16((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 9);
6423663578 return __ret;
6423763579}
6423863580#endif
6423963581
6424063582#ifdef __LITTLE_ENDIAN__
64241__ai uint64x2_t vsubw_high_u32(uint64x2_t __p0, uint32x4_t __p1) {
64242 uint64x2_t __ret;
64243 __ret = __p0 - vmovl_high_u32(__p1);
63583__ai __attribute__((target("fullfp16"))) float16x8_t vdivq_f16(float16x8_t __p0, float16x8_t __p1) {
63584 float16x8_t __ret;
63585 __ret = __p0 / __p1;
6424463586 return __ret;
6424563587}
6424663588#else
64247__ai uint64x2_t vsubw_high_u32(uint64x2_t __p0, uint32x4_t __p1) {
64248 uint64x2_t __ret;
64249 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
64250 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
64251 __ret = __rev0 - __noswap_vmovl_high_u32(__rev1);
64252 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
63589__ai __attribute__((target("fullfp16"))) float16x8_t vdivq_f16(float16x8_t __p0, float16x8_t __p1) {
63590 float16x8_t __ret;
63591 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
63592 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
63593 __ret = __rev0 / __rev1;
63594 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6425363595 return __ret;
6425463596}
6425563597#endif
6425663598
6425763599#ifdef __LITTLE_ENDIAN__
64258__ai uint32x4_t vsubw_high_u16(uint32x4_t __p0, uint16x8_t __p1) {
64259 uint32x4_t __ret;
64260 __ret = __p0 - vmovl_high_u16(__p1);
63600__ai __attribute__((target("fullfp16"))) float16x4_t vdiv_f16(float16x4_t __p0, float16x4_t __p1) {
63601 float16x4_t __ret;
63602 __ret = __p0 / __p1;
6426163603 return __ret;
6426263604}
6426363605#else
64264__ai uint32x4_t vsubw_high_u16(uint32x4_t __p0, uint16x8_t __p1) {
64265 uint32x4_t __ret;
64266 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
64267 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
64268 __ret = __rev0 - __noswap_vmovl_high_u16(__rev1);
63606__ai __attribute__((target("fullfp16"))) float16x4_t vdiv_f16(float16x4_t __p0, float16x4_t __p1) {
63607 float16x4_t __ret;
63608 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
63609 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
63610 __ret = __rev0 / __rev1;
6426963611 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6427063612 return __ret;
6427163613}
6427263614#endif
6427363615
6427463616#ifdef __LITTLE_ENDIAN__
64275__ai int16x8_t vsubw_high_s8(int16x8_t __p0, int8x16_t __p1) {
64276 int16x8_t __ret;
64277 __ret = __p0 - vmovl_high_s8(__p1);
64278 return __ret;
64279}
63617#define vduph_lane_f16(__p0, __p1) __extension__ ({ \
63618 float16_t __ret; \
63619 float16x4_t __s0 = __p0; \
63620 __ret = (float16_t) __builtin_neon_vduph_lane_f16((float16x4_t)__s0, __p1); \
63621 __ret; \
63622})
6428063623#else
64281__ai int16x8_t vsubw_high_s8(int16x8_t __p0, int8x16_t __p1) {
64282 int16x8_t __ret;
64283 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64284 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
64285 __ret = __rev0 - __noswap_vmovl_high_s8(__rev1);
64286 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
64287 return __ret;
64288}
63624#define vduph_lane_f16(__p0, __p1) __extension__ ({ \
63625 float16_t __ret; \
63626 float16x4_t __s0 = __p0; \
63627 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
63628 __ret = (float16_t) __builtin_neon_vduph_lane_f16((float16x4_t)__rev0, __p1); \
63629 __ret; \
63630})
6428963631#endif
6429063632
6429163633#ifdef __LITTLE_ENDIAN__
64292__ai int64x2_t vsubw_high_s32(int64x2_t __p0, int32x4_t __p1) {
64293 int64x2_t __ret;
64294 __ret = __p0 - vmovl_high_s32(__p1);
64295 return __ret;
64296}
63634#define vduph_laneq_f16(__p0, __p1) __extension__ ({ \
63635 float16_t __ret; \
63636 float16x8_t __s0 = __p0; \
63637 __ret = (float16_t) __builtin_neon_vduph_laneq_f16((float16x8_t)__s0, __p1); \
63638 __ret; \
63639})
6429763640#else
64298__ai int64x2_t vsubw_high_s32(int64x2_t __p0, int32x4_t __p1) {
64299 int64x2_t __ret;
64300 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
64301 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
64302 __ret = __rev0 - __noswap_vmovl_high_s32(__rev1);
64303 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
64304 return __ret;
64305}
63641#define vduph_laneq_f16(__p0, __p1) __extension__ ({ \
63642 float16_t __ret; \
63643 float16x8_t __s0 = __p0; \
63644 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
63645 __ret = (float16_t) __builtin_neon_vduph_laneq_f16((float16x8_t)__rev0, __p1); \
63646 __ret; \
63647})
6430663648#endif
6430763649
6430863650#ifdef __LITTLE_ENDIAN__
64309__ai int32x4_t vsubw_high_s16(int32x4_t __p0, int16x8_t __p1) {
64310 int32x4_t __ret;
64311 __ret = __p0 - vmovl_high_s16(__p1);
64312 return __ret;
64313}
63651#define vfmah_lane_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
63652 float16_t __ret; \
63653 float16_t __s0 = __p0; \
63654 float16_t __s1 = __p1; \
63655 float16x4_t __s2 = __p2; \
63656 __ret = (float16_t) __builtin_neon_vfmah_lane_f16(__s0, __s1, (float16x4_t)__s2, __p3); \
63657 __ret; \
63658})
6431463659#else
64315__ai int32x4_t vsubw_high_s16(int32x4_t __p0, int16x8_t __p1) {
64316 int32x4_t __ret;
64317 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
64318 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
64319 __ret = __rev0 - __noswap_vmovl_high_s16(__rev1);
64320 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
64321 return __ret;
64322}
63660#define vfmah_lane_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
63661 float16_t __ret; \
63662 float16_t __s0 = __p0; \
63663 float16_t __s1 = __p1; \
63664 float16x4_t __s2 = __p2; \
63665 float16x4_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 3, 2, 1, 0); \
63666 __ret = (float16_t) __builtin_neon_vfmah_lane_f16(__s0, __s1, (float16x4_t)__rev2, __p3); \
63667 __ret; \
63668})
63669#define __noswap_vfmah_lane_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
63670 float16_t __ret; \
63671 float16_t __s0 = __p0; \
63672 float16_t __s1 = __p1; \
63673 float16x4_t __s2 = __p2; \
63674 __ret = (float16_t) __builtin_neon_vfmah_lane_f16(__s0, __s1, (float16x4_t)__s2, __p3); \
63675 __ret; \
63676})
6432363677#endif
6432463678
6432563679#ifdef __LITTLE_ENDIAN__
64326#define vsudotq_laneq_s32(__p0_843, __p1_843, __p2_843, __p3_843) __extension__ ({ \
64327 int32x4_t __ret_843; \
64328 int32x4_t __s0_843 = __p0_843; \
64329 int8x16_t __s1_843 = __p1_843; \
64330 uint8x16_t __s2_843 = __p2_843; \
64331uint8x16_t __reint_843 = __s2_843; \
64332 __ret_843 = vusdotq_s32(__s0_843, (uint8x16_t)(splatq_laneq_s32(*(int32x4_t *) &__reint_843, __p3_843)), __s1_843); \
64333 __ret_843; \
63680#define vfmaq_lane_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
63681 float16x8_t __ret; \
63682 float16x8_t __s0 = __p0; \
63683 float16x8_t __s1 = __p1; \
63684 float16x4_t __s2 = __p2; \
63685 __ret = (float16x8_t) __builtin_neon_vfmaq_lane_f16((int8x16_t)__s0, (int8x16_t)__s1, (int8x8_t)__s2, __p3, 40); \
63686 __ret; \
6433463687})
6433563688#else
64336#define vsudotq_laneq_s32(__p0_844, __p1_844, __p2_844, __p3_844) __extension__ ({ \
64337 int32x4_t __ret_844; \
64338 int32x4_t __s0_844 = __p0_844; \
64339 int8x16_t __s1_844 = __p1_844; \
64340 uint8x16_t __s2_844 = __p2_844; \
64341 int32x4_t __rev0_844; __rev0_844 = __builtin_shufflevector(__s0_844, __s0_844, 3, 2, 1, 0); \
64342 int8x16_t __rev1_844; __rev1_844 = __builtin_shufflevector(__s1_844, __s1_844, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
64343 uint8x16_t __rev2_844; __rev2_844 = __builtin_shufflevector(__s2_844, __s2_844, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
64344uint8x16_t __reint_844 = __rev2_844; \
64345 __ret_844 = __noswap_vusdotq_s32(__rev0_844, (uint8x16_t)(__noswap_splatq_laneq_s32(*(int32x4_t *) &__reint_844, __p3_844)), __rev1_844); \
64346 __ret_844 = __builtin_shufflevector(__ret_844, __ret_844, 3, 2, 1, 0); \
64347 __ret_844; \
63689#define vfmaq_lane_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
63690 float16x8_t __ret; \
63691 float16x8_t __s0 = __p0; \
63692 float16x8_t __s1 = __p1; \
63693 float16x4_t __s2 = __p2; \
63694 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
63695 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
63696 float16x4_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 3, 2, 1, 0); \
63697 __ret = (float16x8_t) __builtin_neon_vfmaq_lane_f16((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x8_t)__rev2, __p3, 40); \
63698 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
63699 __ret; \
63700})
63701#define __noswap_vfmaq_lane_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
63702 float16x8_t __ret; \
63703 float16x8_t __s0 = __p0; \
63704 float16x8_t __s1 = __p1; \
63705 float16x4_t __s2 = __p2; \
63706 __ret = (float16x8_t) __builtin_neon_vfmaq_lane_f16((int8x16_t)__s0, (int8x16_t)__s1, (int8x8_t)__s2, __p3, 40); \
63707 __ret; \
6434863708})
6434963709#endif
6435063710
6435163711#ifdef __LITTLE_ENDIAN__
64352#define vsudot_laneq_s32(__p0_845, __p1_845, __p2_845, __p3_845) __extension__ ({ \
64353 int32x2_t __ret_845; \
64354 int32x2_t __s0_845 = __p0_845; \
64355 int8x8_t __s1_845 = __p1_845; \
64356 uint8x16_t __s2_845 = __p2_845; \
64357uint8x16_t __reint_845 = __s2_845; \
64358 __ret_845 = vusdot_s32(__s0_845, (uint8x8_t)(splat_laneq_s32(*(int32x4_t *) &__reint_845, __p3_845)), __s1_845); \
64359 __ret_845; \
63712#define vfma_lane_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
63713 float16x4_t __ret; \
63714 float16x4_t __s0 = __p0; \
63715 float16x4_t __s1 = __p1; \
63716 float16x4_t __s2 = __p2; \
63717 __ret = (float16x4_t) __builtin_neon_vfma_lane_f16((int8x8_t)__s0, (int8x8_t)__s1, (int8x8_t)__s2, __p3, 8); \
63718 __ret; \
6436063719})
6436163720#else
64362#define vsudot_laneq_s32(__p0_846, __p1_846, __p2_846, __p3_846) __extension__ ({ \
64363 int32x2_t __ret_846; \
64364 int32x2_t __s0_846 = __p0_846; \
64365 int8x8_t __s1_846 = __p1_846; \
64366 uint8x16_t __s2_846 = __p2_846; \
64367 int32x2_t __rev0_846; __rev0_846 = __builtin_shufflevector(__s0_846, __s0_846, 1, 0); \
64368 int8x8_t __rev1_846; __rev1_846 = __builtin_shufflevector(__s1_846, __s1_846, 7, 6, 5, 4, 3, 2, 1, 0); \
64369 uint8x16_t __rev2_846; __rev2_846 = __builtin_shufflevector(__s2_846, __s2_846, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
64370uint8x16_t __reint_846 = __rev2_846; \
64371 __ret_846 = __noswap_vusdot_s32(__rev0_846, (uint8x8_t)(__noswap_splat_laneq_s32(*(int32x4_t *) &__reint_846, __p3_846)), __rev1_846); \
64372 __ret_846 = __builtin_shufflevector(__ret_846, __ret_846, 1, 0); \
64373 __ret_846; \
63721#define vfma_lane_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
63722 float16x4_t __ret; \
63723 float16x4_t __s0 = __p0; \
63724 float16x4_t __s1 = __p1; \
63725 float16x4_t __s2 = __p2; \
63726 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
63727 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
63728 float16x4_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 3, 2, 1, 0); \
63729 __ret = (float16x4_t) __builtin_neon_vfma_lane_f16((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x8_t)__rev2, __p3, 8); \
63730 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
63731 __ret; \
63732})
63733#define __noswap_vfma_lane_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
63734 float16x4_t __ret; \
63735 float16x4_t __s0 = __p0; \
63736 float16x4_t __s1 = __p1; \
63737 float16x4_t __s2 = __p2; \
63738 __ret = (float16x4_t) __builtin_neon_vfma_lane_f16((int8x8_t)__s0, (int8x8_t)__s1, (int8x8_t)__s2, __p3, 8); \
63739 __ret; \
6437463740})
6437563741#endif
6437663742
6437763743#ifdef __LITTLE_ENDIAN__
64378__ai poly8x8_t vtrn1_p8(poly8x8_t __p0, poly8x8_t __p1) {
64379 poly8x8_t __ret;
64380 __ret = __builtin_shufflevector(__p0, __p1, 0, 8, 2, 10, 4, 12, 6, 14);
64381 return __ret;
64382}
63744#define vfmah_laneq_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
63745 float16_t __ret; \
63746 float16_t __s0 = __p0; \
63747 float16_t __s1 = __p1; \
63748 float16x8_t __s2 = __p2; \
63749 __ret = (float16_t) __builtin_neon_vfmah_laneq_f16(__s0, __s1, (float16x8_t)__s2, __p3); \
63750 __ret; \
63751})
6438363752#else
64384__ai poly8x8_t vtrn1_p8(poly8x8_t __p0, poly8x8_t __p1) {
64385 poly8x8_t __ret;
64386 poly8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64387 poly8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
64388 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 8, 2, 10, 4, 12, 6, 14);
64389 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
64390 return __ret;
64391}
63753#define vfmah_laneq_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
63754 float16_t __ret; \
63755 float16_t __s0 = __p0; \
63756 float16_t __s1 = __p1; \
63757 float16x8_t __s2 = __p2; \
63758 float16x8_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 7, 6, 5, 4, 3, 2, 1, 0); \
63759 __ret = (float16_t) __builtin_neon_vfmah_laneq_f16(__s0, __s1, (float16x8_t)__rev2, __p3); \
63760 __ret; \
63761})
63762#define __noswap_vfmah_laneq_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
63763 float16_t __ret; \
63764 float16_t __s0 = __p0; \
63765 float16_t __s1 = __p1; \
63766 float16x8_t __s2 = __p2; \
63767 __ret = (float16_t) __builtin_neon_vfmah_laneq_f16(__s0, __s1, (float16x8_t)__s2, __p3); \
63768 __ret; \
63769})
6439263770#endif
6439363771
6439463772#ifdef __LITTLE_ENDIAN__
64395__ai poly16x4_t vtrn1_p16(poly16x4_t __p0, poly16x4_t __p1) {
64396 poly16x4_t __ret;
64397 __ret = __builtin_shufflevector(__p0, __p1, 0, 4, 2, 6);
64398 return __ret;
64399}
63773#define vfmaq_laneq_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
63774 float16x8_t __ret; \
63775 float16x8_t __s0 = __p0; \
63776 float16x8_t __s1 = __p1; \
63777 float16x8_t __s2 = __p2; \
63778 __ret = (float16x8_t) __builtin_neon_vfmaq_laneq_f16((int8x16_t)__s0, (int8x16_t)__s1, (int8x16_t)__s2, __p3, 40); \
63779 __ret; \
63780})
6440063781#else
64401__ai poly16x4_t vtrn1_p16(poly16x4_t __p0, poly16x4_t __p1) {
64402 poly16x4_t __ret;
64403 poly16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
64404 poly16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
64405 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 4, 2, 6);
64406 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
64407 return __ret;
64408}
63782#define vfmaq_laneq_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
63783 float16x8_t __ret; \
63784 float16x8_t __s0 = __p0; \
63785 float16x8_t __s1 = __p1; \
63786 float16x8_t __s2 = __p2; \
63787 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
63788 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
63789 float16x8_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 7, 6, 5, 4, 3, 2, 1, 0); \
63790 __ret = (float16x8_t) __builtin_neon_vfmaq_laneq_f16((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, __p3, 40); \
63791 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
63792 __ret; \
63793})
63794#define __noswap_vfmaq_laneq_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
63795 float16x8_t __ret; \
63796 float16x8_t __s0 = __p0; \
63797 float16x8_t __s1 = __p1; \
63798 float16x8_t __s2 = __p2; \
63799 __ret = (float16x8_t) __builtin_neon_vfmaq_laneq_f16((int8x16_t)__s0, (int8x16_t)__s1, (int8x16_t)__s2, __p3, 40); \
63800 __ret; \
63801})
6440963802#endif
6441063803
6441163804#ifdef __LITTLE_ENDIAN__
64412__ai poly8x16_t vtrn1q_p8(poly8x16_t __p0, poly8x16_t __p1) {
64413 poly8x16_t __ret;
64414 __ret = __builtin_shufflevector(__p0, __p1, 0, 16, 2, 18, 4, 20, 6, 22, 8, 24, 10, 26, 12, 28, 14, 30);
64415 return __ret;
64416}
63805#define vfma_laneq_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
63806 float16x4_t __ret; \
63807 float16x4_t __s0 = __p0; \
63808 float16x4_t __s1 = __p1; \
63809 float16x8_t __s2 = __p2; \
63810 __ret = (float16x4_t) __builtin_neon_vfma_laneq_f16((int8x8_t)__s0, (int8x8_t)__s1, (int8x16_t)__s2, __p3, 8); \
63811 __ret; \
63812})
6441763813#else
64418__ai poly8x16_t vtrn1q_p8(poly8x16_t __p0, poly8x16_t __p1) {
64419 poly8x16_t __ret;
64420 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
64421 poly8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
64422 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 16, 2, 18, 4, 20, 6, 22, 8, 24, 10, 26, 12, 28, 14, 30);
64423 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
64424 return __ret;
64425}
63814#define vfma_laneq_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
63815 float16x4_t __ret; \
63816 float16x4_t __s0 = __p0; \
63817 float16x4_t __s1 = __p1; \
63818 float16x8_t __s2 = __p2; \
63819 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
63820 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
63821 float16x8_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 7, 6, 5, 4, 3, 2, 1, 0); \
63822 __ret = (float16x4_t) __builtin_neon_vfma_laneq_f16((int8x8_t)__rev0, (int8x8_t)__rev1, (int8x16_t)__rev2, __p3, 8); \
63823 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
63824 __ret; \
63825})
63826#define __noswap_vfma_laneq_f16(__p0, __p1, __p2, __p3) __extension__ ({ \
63827 float16x4_t __ret; \
63828 float16x4_t __s0 = __p0; \
63829 float16x4_t __s1 = __p1; \
63830 float16x8_t __s2 = __p2; \
63831 __ret = (float16x4_t) __builtin_neon_vfma_laneq_f16((int8x8_t)__s0, (int8x8_t)__s1, (int8x16_t)__s2, __p3, 8); \
63832 __ret; \
63833})
6442663834#endif
6442763835
6442863836#ifdef __LITTLE_ENDIAN__
64429__ai poly64x2_t vtrn1q_p64(poly64x2_t __p0, poly64x2_t __p1) {
64430 poly64x2_t __ret;
64431 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
64432 return __ret;
64433}
63837#define vfmaq_n_f16(__p0, __p1, __p2) __extension__ ({ \
63838 float16x8_t __ret; \
63839 float16x8_t __s0 = __p0; \
63840 float16x8_t __s1 = __p1; \
63841 float16_t __s2 = __p2; \
63842 __ret = vfmaq_f16(__s0, __s1, (float16x8_t) {__s2, __s2, __s2, __s2, __s2, __s2, __s2, __s2}); \
63843 __ret; \
63844})
6443463845#else
64435__ai poly64x2_t vtrn1q_p64(poly64x2_t __p0, poly64x2_t __p1) {
64436 poly64x2_t __ret;
64437 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
64438 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
64439 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
64440 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
64441 return __ret;
64442}
63846#define vfmaq_n_f16(__p0, __p1, __p2) __extension__ ({ \
63847 float16x8_t __ret; \
63848 float16x8_t __s0 = __p0; \
63849 float16x8_t __s1 = __p1; \
63850 float16_t __s2 = __p2; \
63851 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
63852 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
63853 __ret = __noswap_vfmaq_f16(__rev0, __rev1, (float16x8_t) {__s2, __s2, __s2, __s2, __s2, __s2, __s2, __s2}); \
63854 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
63855 __ret; \
63856})
63857#endif
63858
63859#ifdef __LITTLE_ENDIAN__
63860#define vfma_n_f16(__p0, __p1, __p2) __extension__ ({ \
63861 float16x4_t __ret; \
63862 float16x4_t __s0 = __p0; \
63863 float16x4_t __s1 = __p1; \
63864 float16_t __s2 = __p2; \
63865 __ret = vfma_f16(__s0, __s1, (float16x4_t) {__s2, __s2, __s2, __s2}); \
63866 __ret; \
63867})
63868#else
63869#define vfma_n_f16(__p0, __p1, __p2) __extension__ ({ \
63870 float16x4_t __ret; \
63871 float16x4_t __s0 = __p0; \
63872 float16x4_t __s1 = __p1; \
63873 float16_t __s2 = __p2; \
63874 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
63875 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
63876 __ret = __noswap_vfma_f16(__rev0, __rev1, (float16x4_t) {__s2, __s2, __s2, __s2}); \
63877 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
63878 __ret; \
63879})
6444363880#endif
6444463881
6444563882#ifdef __LITTLE_ENDIAN__
64446__ai poly16x8_t vtrn1q_p16(poly16x8_t __p0, poly16x8_t __p1) {
64447 poly16x8_t __ret;
64448 __ret = __builtin_shufflevector(__p0, __p1, 0, 8, 2, 10, 4, 12, 6, 14);
64449 return __ret;
64450}
63883#define vfmsh_lane_f16(__p0_755, __p1_755, __p2_755, __p3_755) __extension__ ({ \
63884 float16_t __ret_755; \
63885 float16_t __s0_755 = __p0_755; \
63886 float16_t __s1_755 = __p1_755; \
63887 float16x4_t __s2_755 = __p2_755; \
63888 __ret_755 = vfmah_lane_f16(__s0_755, -__s1_755, __s2_755, __p3_755); \
63889 __ret_755; \
63890})
6445163891#else
64452__ai poly16x8_t vtrn1q_p16(poly16x8_t __p0, poly16x8_t __p1) {
64453 poly16x8_t __ret;
64454 poly16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64455 poly16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
64456 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 8, 2, 10, 4, 12, 6, 14);
64457 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
64458 return __ret;
64459}
63892#define vfmsh_lane_f16(__p0_756, __p1_756, __p2_756, __p3_756) __extension__ ({ \
63893 float16_t __ret_756; \
63894 float16_t __s0_756 = __p0_756; \
63895 float16_t __s1_756 = __p1_756; \
63896 float16x4_t __s2_756 = __p2_756; \
63897 float16x4_t __rev2_756; __rev2_756 = __builtin_shufflevector(__s2_756, __s2_756, 3, 2, 1, 0); \
63898 __ret_756 = __noswap_vfmah_lane_f16(__s0_756, -__s1_756, __rev2_756, __p3_756); \
63899 __ret_756; \
63900})
6446063901#endif
6446163902
6446263903#ifdef __LITTLE_ENDIAN__
64463__ai uint8x16_t vtrn1q_u8(uint8x16_t __p0, uint8x16_t __p1) {
64464 uint8x16_t __ret;
64465 __ret = __builtin_shufflevector(__p0, __p1, 0, 16, 2, 18, 4, 20, 6, 22, 8, 24, 10, 26, 12, 28, 14, 30);
64466 return __ret;
64467}
63904#define vfmsq_lane_f16(__p0_757, __p1_757, __p2_757, __p3_757) __extension__ ({ \
63905 float16x8_t __ret_757; \
63906 float16x8_t __s0_757 = __p0_757; \
63907 float16x8_t __s1_757 = __p1_757; \
63908 float16x4_t __s2_757 = __p2_757; \
63909 __ret_757 = vfmaq_lane_f16(__s0_757, -__s1_757, __s2_757, __p3_757); \
63910 __ret_757; \
63911})
6446863912#else
64469__ai uint8x16_t vtrn1q_u8(uint8x16_t __p0, uint8x16_t __p1) {
64470 uint8x16_t __ret;
64471 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
64472 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
64473 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 16, 2, 18, 4, 20, 6, 22, 8, 24, 10, 26, 12, 28, 14, 30);
64474 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
64475 return __ret;
64476}
63913#define vfmsq_lane_f16(__p0_758, __p1_758, __p2_758, __p3_758) __extension__ ({ \
63914 float16x8_t __ret_758; \
63915 float16x8_t __s0_758 = __p0_758; \
63916 float16x8_t __s1_758 = __p1_758; \
63917 float16x4_t __s2_758 = __p2_758; \
63918 float16x8_t __rev0_758; __rev0_758 = __builtin_shufflevector(__s0_758, __s0_758, 7, 6, 5, 4, 3, 2, 1, 0); \
63919 float16x8_t __rev1_758; __rev1_758 = __builtin_shufflevector(__s1_758, __s1_758, 7, 6, 5, 4, 3, 2, 1, 0); \
63920 float16x4_t __rev2_758; __rev2_758 = __builtin_shufflevector(__s2_758, __s2_758, 3, 2, 1, 0); \
63921 __ret_758 = __noswap_vfmaq_lane_f16(__rev0_758, -__rev1_758, __rev2_758, __p3_758); \
63922 __ret_758 = __builtin_shufflevector(__ret_758, __ret_758, 7, 6, 5, 4, 3, 2, 1, 0); \
63923 __ret_758; \
63924})
6447763925#endif
6447863926
6447963927#ifdef __LITTLE_ENDIAN__
64480__ai uint32x4_t vtrn1q_u32(uint32x4_t __p0, uint32x4_t __p1) {
64481 uint32x4_t __ret;
64482 __ret = __builtin_shufflevector(__p0, __p1, 0, 4, 2, 6);
64483 return __ret;
64484}
63928#define vfms_lane_f16(__p0_759, __p1_759, __p2_759, __p3_759) __extension__ ({ \
63929 float16x4_t __ret_759; \
63930 float16x4_t __s0_759 = __p0_759; \
63931 float16x4_t __s1_759 = __p1_759; \
63932 float16x4_t __s2_759 = __p2_759; \
63933 __ret_759 = vfma_lane_f16(__s0_759, -__s1_759, __s2_759, __p3_759); \
63934 __ret_759; \
63935})
6448563936#else
64486__ai uint32x4_t vtrn1q_u32(uint32x4_t __p0, uint32x4_t __p1) {
64487 uint32x4_t __ret;
64488 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
64489 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
64490 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 4, 2, 6);
64491 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
64492 return __ret;
64493}
63937#define vfms_lane_f16(__p0_760, __p1_760, __p2_760, __p3_760) __extension__ ({ \
63938 float16x4_t __ret_760; \
63939 float16x4_t __s0_760 = __p0_760; \
63940 float16x4_t __s1_760 = __p1_760; \
63941 float16x4_t __s2_760 = __p2_760; \
63942 float16x4_t __rev0_760; __rev0_760 = __builtin_shufflevector(__s0_760, __s0_760, 3, 2, 1, 0); \
63943 float16x4_t __rev1_760; __rev1_760 = __builtin_shufflevector(__s1_760, __s1_760, 3, 2, 1, 0); \
63944 float16x4_t __rev2_760; __rev2_760 = __builtin_shufflevector(__s2_760, __s2_760, 3, 2, 1, 0); \
63945 __ret_760 = __noswap_vfma_lane_f16(__rev0_760, -__rev1_760, __rev2_760, __p3_760); \
63946 __ret_760 = __builtin_shufflevector(__ret_760, __ret_760, 3, 2, 1, 0); \
63947 __ret_760; \
63948})
6449463949#endif
6449563950
6449663951#ifdef __LITTLE_ENDIAN__
64497__ai uint64x2_t vtrn1q_u64(uint64x2_t __p0, uint64x2_t __p1) {
64498 uint64x2_t __ret;
64499 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
64500 return __ret;
64501}
63952#define vfmsh_laneq_f16(__p0_761, __p1_761, __p2_761, __p3_761) __extension__ ({ \
63953 float16_t __ret_761; \
63954 float16_t __s0_761 = __p0_761; \
63955 float16_t __s1_761 = __p1_761; \
63956 float16x8_t __s2_761 = __p2_761; \
63957 __ret_761 = vfmah_laneq_f16(__s0_761, -__s1_761, __s2_761, __p3_761); \
63958 __ret_761; \
63959})
6450263960#else
64503__ai uint64x2_t vtrn1q_u64(uint64x2_t __p0, uint64x2_t __p1) {
64504 uint64x2_t __ret;
64505 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
64506 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
64507 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
64508 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
64509 return __ret;
64510}
63961#define vfmsh_laneq_f16(__p0_762, __p1_762, __p2_762, __p3_762) __extension__ ({ \
63962 float16_t __ret_762; \
63963 float16_t __s0_762 = __p0_762; \
63964 float16_t __s1_762 = __p1_762; \
63965 float16x8_t __s2_762 = __p2_762; \
63966 float16x8_t __rev2_762; __rev2_762 = __builtin_shufflevector(__s2_762, __s2_762, 7, 6, 5, 4, 3, 2, 1, 0); \
63967 __ret_762 = __noswap_vfmah_laneq_f16(__s0_762, -__s1_762, __rev2_762, __p3_762); \
63968 __ret_762; \
63969})
6451163970#endif
6451263971
6451363972#ifdef __LITTLE_ENDIAN__
64514__ai uint16x8_t vtrn1q_u16(uint16x8_t __p0, uint16x8_t __p1) {
64515 uint16x8_t __ret;
64516 __ret = __builtin_shufflevector(__p0, __p1, 0, 8, 2, 10, 4, 12, 6, 14);
64517 return __ret;
64518}
63973#define vfmsq_laneq_f16(__p0_763, __p1_763, __p2_763, __p3_763) __extension__ ({ \
63974 float16x8_t __ret_763; \
63975 float16x8_t __s0_763 = __p0_763; \
63976 float16x8_t __s1_763 = __p1_763; \
63977 float16x8_t __s2_763 = __p2_763; \
63978 __ret_763 = vfmaq_laneq_f16(__s0_763, -__s1_763, __s2_763, __p3_763); \
63979 __ret_763; \
63980})
6451963981#else
64520__ai uint16x8_t vtrn1q_u16(uint16x8_t __p0, uint16x8_t __p1) {
64521 uint16x8_t __ret;
64522 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64523 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
64524 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 8, 2, 10, 4, 12, 6, 14);
64525 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
64526 return __ret;
64527}
63982#define vfmsq_laneq_f16(__p0_764, __p1_764, __p2_764, __p3_764) __extension__ ({ \
63983 float16x8_t __ret_764; \
63984 float16x8_t __s0_764 = __p0_764; \
63985 float16x8_t __s1_764 = __p1_764; \
63986 float16x8_t __s2_764 = __p2_764; \
63987 float16x8_t __rev0_764; __rev0_764 = __builtin_shufflevector(__s0_764, __s0_764, 7, 6, 5, 4, 3, 2, 1, 0); \
63988 float16x8_t __rev1_764; __rev1_764 = __builtin_shufflevector(__s1_764, __s1_764, 7, 6, 5, 4, 3, 2, 1, 0); \
63989 float16x8_t __rev2_764; __rev2_764 = __builtin_shufflevector(__s2_764, __s2_764, 7, 6, 5, 4, 3, 2, 1, 0); \
63990 __ret_764 = __noswap_vfmaq_laneq_f16(__rev0_764, -__rev1_764, __rev2_764, __p3_764); \
63991 __ret_764 = __builtin_shufflevector(__ret_764, __ret_764, 7, 6, 5, 4, 3, 2, 1, 0); \
63992 __ret_764; \
63993})
6452863994#endif
6452963995
6453063996#ifdef __LITTLE_ENDIAN__
64531__ai int8x16_t vtrn1q_s8(int8x16_t __p0, int8x16_t __p1) {
64532 int8x16_t __ret;
64533 __ret = __builtin_shufflevector(__p0, __p1, 0, 16, 2, 18, 4, 20, 6, 22, 8, 24, 10, 26, 12, 28, 14, 30);
64534 return __ret;
64535}
63997#define vfms_laneq_f16(__p0_765, __p1_765, __p2_765, __p3_765) __extension__ ({ \
63998 float16x4_t __ret_765; \
63999 float16x4_t __s0_765 = __p0_765; \
64000 float16x4_t __s1_765 = __p1_765; \
64001 float16x8_t __s2_765 = __p2_765; \
64002 __ret_765 = vfma_laneq_f16(__s0_765, -__s1_765, __s2_765, __p3_765); \
64003 __ret_765; \
64004})
6453664005#else
64537__ai int8x16_t vtrn1q_s8(int8x16_t __p0, int8x16_t __p1) {
64538 int8x16_t __ret;
64539 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
64540 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
64541 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 16, 2, 18, 4, 20, 6, 22, 8, 24, 10, 26, 12, 28, 14, 30);
64542 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
64543 return __ret;
64544}
64006#define vfms_laneq_f16(__p0_766, __p1_766, __p2_766, __p3_766) __extension__ ({ \
64007 float16x4_t __ret_766; \
64008 float16x4_t __s0_766 = __p0_766; \
64009 float16x4_t __s1_766 = __p1_766; \
64010 float16x8_t __s2_766 = __p2_766; \
64011 float16x4_t __rev0_766; __rev0_766 = __builtin_shufflevector(__s0_766, __s0_766, 3, 2, 1, 0); \
64012 float16x4_t __rev1_766; __rev1_766 = __builtin_shufflevector(__s1_766, __s1_766, 3, 2, 1, 0); \
64013 float16x8_t __rev2_766; __rev2_766 = __builtin_shufflevector(__s2_766, __s2_766, 7, 6, 5, 4, 3, 2, 1, 0); \
64014 __ret_766 = __noswap_vfma_laneq_f16(__rev0_766, -__rev1_766, __rev2_766, __p3_766); \
64015 __ret_766 = __builtin_shufflevector(__ret_766, __ret_766, 3, 2, 1, 0); \
64016 __ret_766; \
64017})
6454564018#endif
6454664019
6454764020#ifdef __LITTLE_ENDIAN__
64548__ai float64x2_t vtrn1q_f64(float64x2_t __p0, float64x2_t __p1) {
64549 float64x2_t __ret;
64550 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
64551 return __ret;
64552}
64021#define vfmsq_n_f16(__p0, __p1, __p2) __extension__ ({ \
64022 float16x8_t __ret; \
64023 float16x8_t __s0 = __p0; \
64024 float16x8_t __s1 = __p1; \
64025 float16_t __s2 = __p2; \
64026 __ret = vfmaq_f16(__s0, -__s1, (float16x8_t) {__s2, __s2, __s2, __s2, __s2, __s2, __s2, __s2}); \
64027 __ret; \
64028})
6455364029#else
64554__ai float64x2_t vtrn1q_f64(float64x2_t __p0, float64x2_t __p1) {
64555 float64x2_t __ret;
64556 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
64557 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
64558 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
64559 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
64560 return __ret;
64561}
64030#define vfmsq_n_f16(__p0, __p1, __p2) __extension__ ({ \
64031 float16x8_t __ret; \
64032 float16x8_t __s0 = __p0; \
64033 float16x8_t __s1 = __p1; \
64034 float16_t __s2 = __p2; \
64035 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
64036 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
64037 __ret = __noswap_vfmaq_f16(__rev0, -__rev1, (float16x8_t) {__s2, __s2, __s2, __s2, __s2, __s2, __s2, __s2}); \
64038 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
64039 __ret; \
64040})
6456264041#endif
6456364042
6456464043#ifdef __LITTLE_ENDIAN__
64565__ai float32x4_t vtrn1q_f32(float32x4_t __p0, float32x4_t __p1) {
64566 float32x4_t __ret;
64567 __ret = __builtin_shufflevector(__p0, __p1, 0, 4, 2, 6);
64568 return __ret;
64569}
64044#define vfms_n_f16(__p0, __p1, __p2) __extension__ ({ \
64045 float16x4_t __ret; \
64046 float16x4_t __s0 = __p0; \
64047 float16x4_t __s1 = __p1; \
64048 float16_t __s2 = __p2; \
64049 __ret = vfma_f16(__s0, -__s1, (float16x4_t) {__s2, __s2, __s2, __s2}); \
64050 __ret; \
64051})
6457064052#else
64571__ai float32x4_t vtrn1q_f32(float32x4_t __p0, float32x4_t __p1) {
64572 float32x4_t __ret;
64573 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
64574 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
64575 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 4, 2, 6);
64576 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
64577 return __ret;
64578}
64053#define vfms_n_f16(__p0, __p1, __p2) __extension__ ({ \
64054 float16x4_t __ret; \
64055 float16x4_t __s0 = __p0; \
64056 float16x4_t __s1 = __p1; \
64057 float16_t __s2 = __p2; \
64058 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
64059 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
64060 __ret = __noswap_vfma_f16(__rev0, -__rev1, (float16x4_t) {__s2, __s2, __s2, __s2}); \
64061 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
64062 __ret; \
64063})
6457964064#endif
6458064065
6458164066#ifdef __LITTLE_ENDIAN__
64582__ai int32x4_t vtrn1q_s32(int32x4_t __p0, int32x4_t __p1) {
64583 int32x4_t __ret;
64584 __ret = __builtin_shufflevector(__p0, __p1, 0, 4, 2, 6);
64585 return __ret;
64586}
64067#define vmaxnmvq_f16(__p0) __extension__ ({ \
64068 float16_t __ret; \
64069 float16x8_t __s0 = __p0; \
64070 __ret = (float16_t) __builtin_neon_vmaxnmvq_f16((int8x16_t)__s0); \
64071 __ret; \
64072})
6458764073#else
64588__ai int32x4_t vtrn1q_s32(int32x4_t __p0, int32x4_t __p1) {
64589 int32x4_t __ret;
64590 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
64591 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
64592 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 4, 2, 6);
64593 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
64594 return __ret;
64595}
64074#define vmaxnmvq_f16(__p0) __extension__ ({ \
64075 float16_t __ret; \
64076 float16x8_t __s0 = __p0; \
64077 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
64078 __ret = (float16_t) __builtin_neon_vmaxnmvq_f16((int8x16_t)__rev0); \
64079 __ret; \
64080})
6459664081#endif
6459764082
6459864083#ifdef __LITTLE_ENDIAN__
64599__ai int64x2_t vtrn1q_s64(int64x2_t __p0, int64x2_t __p1) {
64600 int64x2_t __ret;
64601 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
64602 return __ret;
64603}
64084#define vmaxnmv_f16(__p0) __extension__ ({ \
64085 float16_t __ret; \
64086 float16x4_t __s0 = __p0; \
64087 __ret = (float16_t) __builtin_neon_vmaxnmv_f16((int8x8_t)__s0); \
64088 __ret; \
64089})
6460464090#else
64605__ai int64x2_t vtrn1q_s64(int64x2_t __p0, int64x2_t __p1) {
64606 int64x2_t __ret;
64607 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
64608 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
64609 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
64610 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
64611 return __ret;
64612}
64091#define vmaxnmv_f16(__p0) __extension__ ({ \
64092 float16_t __ret; \
64093 float16x4_t __s0 = __p0; \
64094 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
64095 __ret = (float16_t) __builtin_neon_vmaxnmv_f16((int8x8_t)__rev0); \
64096 __ret; \
64097})
6461364098#endif
6461464099
6461564100#ifdef __LITTLE_ENDIAN__
64616__ai int16x8_t vtrn1q_s16(int16x8_t __p0, int16x8_t __p1) {
64617 int16x8_t __ret;
64618 __ret = __builtin_shufflevector(__p0, __p1, 0, 8, 2, 10, 4, 12, 6, 14);
64619 return __ret;
64620}
64101#define vmaxvq_f16(__p0) __extension__ ({ \
64102 float16_t __ret; \
64103 float16x8_t __s0 = __p0; \
64104 __ret = (float16_t) __builtin_neon_vmaxvq_f16((int8x16_t)__s0); \
64105 __ret; \
64106})
6462164107#else
64622__ai int16x8_t vtrn1q_s16(int16x8_t __p0, int16x8_t __p1) {
64623 int16x8_t __ret;
64624 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64625 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
64626 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 8, 2, 10, 4, 12, 6, 14);
64627 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
64628 return __ret;
64629}
64108#define vmaxvq_f16(__p0) __extension__ ({ \
64109 float16_t __ret; \
64110 float16x8_t __s0 = __p0; \
64111 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
64112 __ret = (float16_t) __builtin_neon_vmaxvq_f16((int8x16_t)__rev0); \
64113 __ret; \
64114})
6463064115#endif
6463164116
6463264117#ifdef __LITTLE_ENDIAN__
64633__ai uint8x8_t vtrn1_u8(uint8x8_t __p0, uint8x8_t __p1) {
64634 uint8x8_t __ret;
64635 __ret = __builtin_shufflevector(__p0, __p1, 0, 8, 2, 10, 4, 12, 6, 14);
64636 return __ret;
64637}
64118#define vmaxv_f16(__p0) __extension__ ({ \
64119 float16_t __ret; \
64120 float16x4_t __s0 = __p0; \
64121 __ret = (float16_t) __builtin_neon_vmaxv_f16((int8x8_t)__s0); \
64122 __ret; \
64123})
6463864124#else
64639__ai uint8x8_t vtrn1_u8(uint8x8_t __p0, uint8x8_t __p1) {
64640 uint8x8_t __ret;
64641 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64642 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
64643 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 8, 2, 10, 4, 12, 6, 14);
64644 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
64645 return __ret;
64646}
64125#define vmaxv_f16(__p0) __extension__ ({ \
64126 float16_t __ret; \
64127 float16x4_t __s0 = __p0; \
64128 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
64129 __ret = (float16_t) __builtin_neon_vmaxv_f16((int8x8_t)__rev0); \
64130 __ret; \
64131})
6464764132#endif
6464864133
6464964134#ifdef __LITTLE_ENDIAN__
64650__ai uint32x2_t vtrn1_u32(uint32x2_t __p0, uint32x2_t __p1) {
64651 uint32x2_t __ret;
64652 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
64653 return __ret;
64654}
64135#define vminnmvq_f16(__p0) __extension__ ({ \
64136 float16_t __ret; \
64137 float16x8_t __s0 = __p0; \
64138 __ret = (float16_t) __builtin_neon_vminnmvq_f16((int8x16_t)__s0); \
64139 __ret; \
64140})
6465564141#else
64656__ai uint32x2_t vtrn1_u32(uint32x2_t __p0, uint32x2_t __p1) {
64657 uint32x2_t __ret;
64658 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
64659 uint32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
64660 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
64661 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
64662 return __ret;
64663}
64142#define vminnmvq_f16(__p0) __extension__ ({ \
64143 float16_t __ret; \
64144 float16x8_t __s0 = __p0; \
64145 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
64146 __ret = (float16_t) __builtin_neon_vminnmvq_f16((int8x16_t)__rev0); \
64147 __ret; \
64148})
6466464149#endif
6466564150
6466664151#ifdef __LITTLE_ENDIAN__
64667__ai uint16x4_t vtrn1_u16(uint16x4_t __p0, uint16x4_t __p1) {
64668 uint16x4_t __ret;
64669 __ret = __builtin_shufflevector(__p0, __p1, 0, 4, 2, 6);
64670 return __ret;
64671}
64152#define vminnmv_f16(__p0) __extension__ ({ \
64153 float16_t __ret; \
64154 float16x4_t __s0 = __p0; \
64155 __ret = (float16_t) __builtin_neon_vminnmv_f16((int8x8_t)__s0); \
64156 __ret; \
64157})
6467264158#else
64673__ai uint16x4_t vtrn1_u16(uint16x4_t __p0, uint16x4_t __p1) {
64674 uint16x4_t __ret;
64675 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
64676 uint16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
64677 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 4, 2, 6);
64678 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
64679 return __ret;
64680}
64159#define vminnmv_f16(__p0) __extension__ ({ \
64160 float16_t __ret; \
64161 float16x4_t __s0 = __p0; \
64162 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
64163 __ret = (float16_t) __builtin_neon_vminnmv_f16((int8x8_t)__rev0); \
64164 __ret; \
64165})
6468164166#endif
6468264167
6468364168#ifdef __LITTLE_ENDIAN__
64684__ai int8x8_t vtrn1_s8(int8x8_t __p0, int8x8_t __p1) {
64685 int8x8_t __ret;
64686 __ret = __builtin_shufflevector(__p0, __p1, 0, 8, 2, 10, 4, 12, 6, 14);
64687 return __ret;
64688}
64169#define vminvq_f16(__p0) __extension__ ({ \
64170 float16_t __ret; \
64171 float16x8_t __s0 = __p0; \
64172 __ret = (float16_t) __builtin_neon_vminvq_f16((int8x16_t)__s0); \
64173 __ret; \
64174})
6468964175#else
64690__ai int8x8_t vtrn1_s8(int8x8_t __p0, int8x8_t __p1) {
64691 int8x8_t __ret;
64692 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64693 int8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
64694 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 8, 2, 10, 4, 12, 6, 14);
64695 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
64696 return __ret;
64697}
64176#define vminvq_f16(__p0) __extension__ ({ \
64177 float16_t __ret; \
64178 float16x8_t __s0 = __p0; \
64179 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
64180 __ret = (float16_t) __builtin_neon_vminvq_f16((int8x16_t)__rev0); \
64181 __ret; \
64182})
6469864183#endif
6469964184
6470064185#ifdef __LITTLE_ENDIAN__
64701__ai float32x2_t vtrn1_f32(float32x2_t __p0, float32x2_t __p1) {
64702 float32x2_t __ret;
64703 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
64704 return __ret;
64705}
64186#define vminv_f16(__p0) __extension__ ({ \
64187 float16_t __ret; \
64188 float16x4_t __s0 = __p0; \
64189 __ret = (float16_t) __builtin_neon_vminv_f16((int8x8_t)__s0); \
64190 __ret; \
64191})
6470664192#else
64707__ai float32x2_t vtrn1_f32(float32x2_t __p0, float32x2_t __p1) {
64708 float32x2_t __ret;
64709 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
64710 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
64711 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
64712 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
64713 return __ret;
64714}
64193#define vminv_f16(__p0) __extension__ ({ \
64194 float16_t __ret; \
64195 float16x4_t __s0 = __p0; \
64196 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
64197 __ret = (float16_t) __builtin_neon_vminv_f16((int8x8_t)__rev0); \
64198 __ret; \
64199})
6471564200#endif
6471664201
6471764202#ifdef __LITTLE_ENDIAN__
64718__ai int32x2_t vtrn1_s32(int32x2_t __p0, int32x2_t __p1) {
64719 int32x2_t __ret;
64720 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
64721 return __ret;
64722}
64203#define vmulq_laneq_f16(__p0_767, __p1_767, __p2_767) __extension__ ({ \
64204 float16x8_t __ret_767; \
64205 float16x8_t __s0_767 = __p0_767; \
64206 float16x8_t __s1_767 = __p1_767; \
64207 __ret_767 = __s0_767 * splatq_laneq_f16(__s1_767, __p2_767); \
64208 __ret_767; \
64209})
6472364210#else
64724__ai int32x2_t vtrn1_s32(int32x2_t __p0, int32x2_t __p1) {
64725 int32x2_t __ret;
64726 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
64727 int32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
64728 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
64729 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
64730 return __ret;
64731}
64211#define vmulq_laneq_f16(__p0_768, __p1_768, __p2_768) __extension__ ({ \
64212 float16x8_t __ret_768; \
64213 float16x8_t __s0_768 = __p0_768; \
64214 float16x8_t __s1_768 = __p1_768; \
64215 float16x8_t __rev0_768; __rev0_768 = __builtin_shufflevector(__s0_768, __s0_768, 7, 6, 5, 4, 3, 2, 1, 0); \
64216 float16x8_t __rev1_768; __rev1_768 = __builtin_shufflevector(__s1_768, __s1_768, 7, 6, 5, 4, 3, 2, 1, 0); \
64217 __ret_768 = __rev0_768 * __noswap_splatq_laneq_f16(__rev1_768, __p2_768); \
64218 __ret_768 = __builtin_shufflevector(__ret_768, __ret_768, 7, 6, 5, 4, 3, 2, 1, 0); \
64219 __ret_768; \
64220})
6473264221#endif
6473364222
6473464223#ifdef __LITTLE_ENDIAN__
64735__ai int16x4_t vtrn1_s16(int16x4_t __p0, int16x4_t __p1) {
64736 int16x4_t __ret;
64737 __ret = __builtin_shufflevector(__p0, __p1, 0, 4, 2, 6);
64738 return __ret;
64739}
64224#define vmul_laneq_f16(__p0_769, __p1_769, __p2_769) __extension__ ({ \
64225 float16x4_t __ret_769; \
64226 float16x4_t __s0_769 = __p0_769; \
64227 float16x8_t __s1_769 = __p1_769; \
64228 __ret_769 = __s0_769 * splat_laneq_f16(__s1_769, __p2_769); \
64229 __ret_769; \
64230})
6474064231#else
64741__ai int16x4_t vtrn1_s16(int16x4_t __p0, int16x4_t __p1) {
64742 int16x4_t __ret;
64743 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
64744 int16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
64745 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 4, 2, 6);
64746 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
64747 return __ret;
64748}
64232#define vmul_laneq_f16(__p0_770, __p1_770, __p2_770) __extension__ ({ \
64233 float16x4_t __ret_770; \
64234 float16x4_t __s0_770 = __p0_770; \
64235 float16x8_t __s1_770 = __p1_770; \
64236 float16x4_t __rev0_770; __rev0_770 = __builtin_shufflevector(__s0_770, __s0_770, 3, 2, 1, 0); \
64237 float16x8_t __rev1_770; __rev1_770 = __builtin_shufflevector(__s1_770, __s1_770, 7, 6, 5, 4, 3, 2, 1, 0); \
64238 __ret_770 = __rev0_770 * __noswap_splat_laneq_f16(__rev1_770, __p2_770); \
64239 __ret_770 = __builtin_shufflevector(__ret_770, __ret_770, 3, 2, 1, 0); \
64240 __ret_770; \
64241})
6474964242#endif
6475064243
6475164244#ifdef __LITTLE_ENDIAN__
64752__ai poly8x8_t vtrn2_p8(poly8x8_t __p0, poly8x8_t __p1) {
64753 poly8x8_t __ret;
64754 __ret = __builtin_shufflevector(__p0, __p1, 1, 9, 3, 11, 5, 13, 7, 15);
64245__ai __attribute__((target("fullfp16"))) float16x8_t vmulxq_f16(float16x8_t __p0, float16x8_t __p1) {
64246 float16x8_t __ret;
64247 __ret = (float16x8_t) __builtin_neon_vmulxq_f16((int8x16_t)__p0, (int8x16_t)__p1, 40);
6475564248 return __ret;
6475664249}
6475764250#else
64758__ai poly8x8_t vtrn2_p8(poly8x8_t __p0, poly8x8_t __p1) {
64759 poly8x8_t __ret;
64760 poly8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64761 poly8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
64762 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 9, 3, 11, 5, 13, 7, 15);
64251__ai __attribute__((target("fullfp16"))) float16x8_t vmulxq_f16(float16x8_t __p0, float16x8_t __p1) {
64252 float16x8_t __ret;
64253 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64254 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
64255 __ret = (float16x8_t) __builtin_neon_vmulxq_f16((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
6476364256 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6476464257 return __ret;
6476564258}
64766#endif
64767
64768#ifdef __LITTLE_ENDIAN__
64769__ai poly16x4_t vtrn2_p16(poly16x4_t __p0, poly16x4_t __p1) {
64770 poly16x4_t __ret;
64771 __ret = __builtin_shufflevector(__p0, __p1, 1, 5, 3, 7);
64772 return __ret;
64773}
64774#else
64775__ai poly16x4_t vtrn2_p16(poly16x4_t __p0, poly16x4_t __p1) {
64776 poly16x4_t __ret;
64777 poly16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
64778 poly16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
64779 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 5, 3, 7);
64780 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
64259__ai __attribute__((target("fullfp16"))) float16x8_t __noswap_vmulxq_f16(float16x8_t __p0, float16x8_t __p1) {
64260 float16x8_t __ret;
64261 __ret = (float16x8_t) __builtin_neon_vmulxq_f16((int8x16_t)__p0, (int8x16_t)__p1, 40);
6478164262 return __ret;
6478264263}
6478364264#endif
6478464265
6478564266#ifdef __LITTLE_ENDIAN__
64786__ai poly8x16_t vtrn2q_p8(poly8x16_t __p0, poly8x16_t __p1) {
64787 poly8x16_t __ret;
64788 __ret = __builtin_shufflevector(__p0, __p1, 1, 17, 3, 19, 5, 21, 7, 23, 9, 25, 11, 27, 13, 29, 15, 31);
64267__ai __attribute__((target("fullfp16"))) float16x4_t vmulx_f16(float16x4_t __p0, float16x4_t __p1) {
64268 float16x4_t __ret;
64269 __ret = (float16x4_t) __builtin_neon_vmulx_f16((int8x8_t)__p0, (int8x8_t)__p1, 8);
6478964270 return __ret;
6479064271}
6479164272#else
64792__ai poly8x16_t vtrn2q_p8(poly8x16_t __p0, poly8x16_t __p1) {
64793 poly8x16_t __ret;
64794 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
64795 poly8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
64796 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 17, 3, 19, 5, 21, 7, 23, 9, 25, 11, 27, 13, 29, 15, 31);
64797 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
64798 return __ret;
64799}
64800#endif
64801
64802#ifdef __LITTLE_ENDIAN__
64803__ai poly64x2_t vtrn2q_p64(poly64x2_t __p0, poly64x2_t __p1) {
64804 poly64x2_t __ret;
64805 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
64273__ai __attribute__((target("fullfp16"))) float16x4_t vmulx_f16(float16x4_t __p0, float16x4_t __p1) {
64274 float16x4_t __ret;
64275 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
64276 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
64277 __ret = (float16x4_t) __builtin_neon_vmulx_f16((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
64278 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6480664279 return __ret;
6480764280}
64808#else
64809__ai poly64x2_t vtrn2q_p64(poly64x2_t __p0, poly64x2_t __p1) {
64810 poly64x2_t __ret;
64811 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
64812 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
64813 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
64814 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
64281__ai __attribute__((target("fullfp16"))) float16x4_t __noswap_vmulx_f16(float16x4_t __p0, float16x4_t __p1) {
64282 float16x4_t __ret;
64283 __ret = (float16x4_t) __builtin_neon_vmulx_f16((int8x8_t)__p0, (int8x8_t)__p1, 8);
6481564284 return __ret;
6481664285}
6481764286#endif
6481864287
6481964288#ifdef __LITTLE_ENDIAN__
64820__ai poly16x8_t vtrn2q_p16(poly16x8_t __p0, poly16x8_t __p1) {
64821 poly16x8_t __ret;
64822 __ret = __builtin_shufflevector(__p0, __p1, 1, 9, 3, 11, 5, 13, 7, 15);
64823 return __ret;
64824}
64289#define vmulxh_lane_f16(__p0, __p1, __p2) __extension__ ({ \
64290 float16_t __ret; \
64291 float16_t __s0 = __p0; \
64292 float16x4_t __s1 = __p1; \
64293 __ret = (float16_t) __builtin_neon_vmulxh_lane_f16(__s0, (float16x4_t)__s1, __p2); \
64294 __ret; \
64295})
6482564296#else
64826__ai poly16x8_t vtrn2q_p16(poly16x8_t __p0, poly16x8_t __p1) {
64827 poly16x8_t __ret;
64828 poly16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64829 poly16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
64830 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 9, 3, 11, 5, 13, 7, 15);
64831 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
64832 return __ret;
64833}
64297#define vmulxh_lane_f16(__p0, __p1, __p2) __extension__ ({ \
64298 float16_t __ret; \
64299 float16_t __s0 = __p0; \
64300 float16x4_t __s1 = __p1; \
64301 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
64302 __ret = (float16_t) __builtin_neon_vmulxh_lane_f16(__s0, (float16x4_t)__rev1, __p2); \
64303 __ret; \
64304})
6483464305#endif
6483564306
6483664307#ifdef __LITTLE_ENDIAN__
64837__ai uint8x16_t vtrn2q_u8(uint8x16_t __p0, uint8x16_t __p1) {
64838 uint8x16_t __ret;
64839 __ret = __builtin_shufflevector(__p0, __p1, 1, 17, 3, 19, 5, 21, 7, 23, 9, 25, 11, 27, 13, 29, 15, 31);
64840 return __ret;
64841}
64308#define vmulxq_lane_f16(__p0_771, __p1_771, __p2_771) __extension__ ({ \
64309 float16x8_t __ret_771; \
64310 float16x8_t __s0_771 = __p0_771; \
64311 float16x4_t __s1_771 = __p1_771; \
64312 __ret_771 = vmulxq_f16(__s0_771, splatq_lane_f16(__s1_771, __p2_771)); \
64313 __ret_771; \
64314})
64315#else
64316#define vmulxq_lane_f16(__p0_772, __p1_772, __p2_772) __extension__ ({ \
64317 float16x8_t __ret_772; \
64318 float16x8_t __s0_772 = __p0_772; \
64319 float16x4_t __s1_772 = __p1_772; \
64320 float16x8_t __rev0_772; __rev0_772 = __builtin_shufflevector(__s0_772, __s0_772, 7, 6, 5, 4, 3, 2, 1, 0); \
64321 float16x4_t __rev1_772; __rev1_772 = __builtin_shufflevector(__s1_772, __s1_772, 3, 2, 1, 0); \
64322 __ret_772 = __noswap_vmulxq_f16(__rev0_772, __noswap_splatq_lane_f16(__rev1_772, __p2_772)); \
64323 __ret_772 = __builtin_shufflevector(__ret_772, __ret_772, 7, 6, 5, 4, 3, 2, 1, 0); \
64324 __ret_772; \
64325})
64326#endif
64327
64328#ifdef __LITTLE_ENDIAN__
64329#define vmulx_lane_f16(__p0_773, __p1_773, __p2_773) __extension__ ({ \
64330 float16x4_t __ret_773; \
64331 float16x4_t __s0_773 = __p0_773; \
64332 float16x4_t __s1_773 = __p1_773; \
64333 __ret_773 = vmulx_f16(__s0_773, splat_lane_f16(__s1_773, __p2_773)); \
64334 __ret_773; \
64335})
6484264336#else
64843__ai uint8x16_t vtrn2q_u8(uint8x16_t __p0, uint8x16_t __p1) {
64844 uint8x16_t __ret;
64845 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
64846 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
64847 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 17, 3, 19, 5, 21, 7, 23, 9, 25, 11, 27, 13, 29, 15, 31);
64848 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
64849 return __ret;
64850}
64337#define vmulx_lane_f16(__p0_774, __p1_774, __p2_774) __extension__ ({ \
64338 float16x4_t __ret_774; \
64339 float16x4_t __s0_774 = __p0_774; \
64340 float16x4_t __s1_774 = __p1_774; \
64341 float16x4_t __rev0_774; __rev0_774 = __builtin_shufflevector(__s0_774, __s0_774, 3, 2, 1, 0); \
64342 float16x4_t __rev1_774; __rev1_774 = __builtin_shufflevector(__s1_774, __s1_774, 3, 2, 1, 0); \
64343 __ret_774 = __noswap_vmulx_f16(__rev0_774, __noswap_splat_lane_f16(__rev1_774, __p2_774)); \
64344 __ret_774 = __builtin_shufflevector(__ret_774, __ret_774, 3, 2, 1, 0); \
64345 __ret_774; \
64346})
6485164347#endif
6485264348
6485364349#ifdef __LITTLE_ENDIAN__
64854__ai uint32x4_t vtrn2q_u32(uint32x4_t __p0, uint32x4_t __p1) {
64855 uint32x4_t __ret;
64856 __ret = __builtin_shufflevector(__p0, __p1, 1, 5, 3, 7);
64857 return __ret;
64858}
64350#define vmulxh_laneq_f16(__p0, __p1, __p2) __extension__ ({ \
64351 float16_t __ret; \
64352 float16_t __s0 = __p0; \
64353 float16x8_t __s1 = __p1; \
64354 __ret = (float16_t) __builtin_neon_vmulxh_laneq_f16(__s0, (float16x8_t)__s1, __p2); \
64355 __ret; \
64356})
6485964357#else
64860__ai uint32x4_t vtrn2q_u32(uint32x4_t __p0, uint32x4_t __p1) {
64861 uint32x4_t __ret;
64862 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
64863 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
64864 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 5, 3, 7);
64865 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
64866 return __ret;
64867}
64358#define vmulxh_laneq_f16(__p0, __p1, __p2) __extension__ ({ \
64359 float16_t __ret; \
64360 float16_t __s0 = __p0; \
64361 float16x8_t __s1 = __p1; \
64362 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 7, 6, 5, 4, 3, 2, 1, 0); \
64363 __ret = (float16_t) __builtin_neon_vmulxh_laneq_f16(__s0, (float16x8_t)__rev1, __p2); \
64364 __ret; \
64365})
6486864366#endif
6486964367
6487064368#ifdef __LITTLE_ENDIAN__
64871__ai uint64x2_t vtrn2q_u64(uint64x2_t __p0, uint64x2_t __p1) {
64872 uint64x2_t __ret;
64873 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
64874 return __ret;
64875}
64369#define vmulxq_laneq_f16(__p0_775, __p1_775, __p2_775) __extension__ ({ \
64370 float16x8_t __ret_775; \
64371 float16x8_t __s0_775 = __p0_775; \
64372 float16x8_t __s1_775 = __p1_775; \
64373 __ret_775 = vmulxq_f16(__s0_775, splatq_laneq_f16(__s1_775, __p2_775)); \
64374 __ret_775; \
64375})
6487664376#else
64877__ai uint64x2_t vtrn2q_u64(uint64x2_t __p0, uint64x2_t __p1) {
64878 uint64x2_t __ret;
64879 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
64880 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
64881 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
64882 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
64883 return __ret;
64884}
64377#define vmulxq_laneq_f16(__p0_776, __p1_776, __p2_776) __extension__ ({ \
64378 float16x8_t __ret_776; \
64379 float16x8_t __s0_776 = __p0_776; \
64380 float16x8_t __s1_776 = __p1_776; \
64381 float16x8_t __rev0_776; __rev0_776 = __builtin_shufflevector(__s0_776, __s0_776, 7, 6, 5, 4, 3, 2, 1, 0); \
64382 float16x8_t __rev1_776; __rev1_776 = __builtin_shufflevector(__s1_776, __s1_776, 7, 6, 5, 4, 3, 2, 1, 0); \
64383 __ret_776 = __noswap_vmulxq_f16(__rev0_776, __noswap_splatq_laneq_f16(__rev1_776, __p2_776)); \
64384 __ret_776 = __builtin_shufflevector(__ret_776, __ret_776, 7, 6, 5, 4, 3, 2, 1, 0); \
64385 __ret_776; \
64386})
6488564387#endif
6488664388
6488764389#ifdef __LITTLE_ENDIAN__
64888__ai uint16x8_t vtrn2q_u16(uint16x8_t __p0, uint16x8_t __p1) {
64889 uint16x8_t __ret;
64890 __ret = __builtin_shufflevector(__p0, __p1, 1, 9, 3, 11, 5, 13, 7, 15);
64891 return __ret;
64892}
64390#define vmulx_laneq_f16(__p0_777, __p1_777, __p2_777) __extension__ ({ \
64391 float16x4_t __ret_777; \
64392 float16x4_t __s0_777 = __p0_777; \
64393 float16x8_t __s1_777 = __p1_777; \
64394 __ret_777 = vmulx_f16(__s0_777, splat_laneq_f16(__s1_777, __p2_777)); \
64395 __ret_777; \
64396})
6489364397#else
64894__ai uint16x8_t vtrn2q_u16(uint16x8_t __p0, uint16x8_t __p1) {
64895 uint16x8_t __ret;
64896 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64897 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
64898 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 9, 3, 11, 5, 13, 7, 15);
64899 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
64900 return __ret;
64901}
64398#define vmulx_laneq_f16(__p0_778, __p1_778, __p2_778) __extension__ ({ \
64399 float16x4_t __ret_778; \
64400 float16x4_t __s0_778 = __p0_778; \
64401 float16x8_t __s1_778 = __p1_778; \
64402 float16x4_t __rev0_778; __rev0_778 = __builtin_shufflevector(__s0_778, __s0_778, 3, 2, 1, 0); \
64403 float16x8_t __rev1_778; __rev1_778 = __builtin_shufflevector(__s1_778, __s1_778, 7, 6, 5, 4, 3, 2, 1, 0); \
64404 __ret_778 = __noswap_vmulx_f16(__rev0_778, __noswap_splat_laneq_f16(__rev1_778, __p2_778)); \
64405 __ret_778 = __builtin_shufflevector(__ret_778, __ret_778, 3, 2, 1, 0); \
64406 __ret_778; \
64407})
6490264408#endif
6490364409
6490464410#ifdef __LITTLE_ENDIAN__
64905__ai int8x16_t vtrn2q_s8(int8x16_t __p0, int8x16_t __p1) {
64906 int8x16_t __ret;
64907 __ret = __builtin_shufflevector(__p0, __p1, 1, 17, 3, 19, 5, 21, 7, 23, 9, 25, 11, 27, 13, 29, 15, 31);
64908 return __ret;
64909}
64411#define vmulxq_n_f16(__p0, __p1) __extension__ ({ \
64412 float16x8_t __ret; \
64413 float16x8_t __s0 = __p0; \
64414 float16_t __s1 = __p1; \
64415 __ret = vmulxq_f16(__s0, (float16x8_t) {__s1, __s1, __s1, __s1, __s1, __s1, __s1, __s1}); \
64416 __ret; \
64417})
6491064418#else
64911__ai int8x16_t vtrn2q_s8(int8x16_t __p0, int8x16_t __p1) {
64912 int8x16_t __ret;
64913 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
64914 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
64915 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 17, 3, 19, 5, 21, 7, 23, 9, 25, 11, 27, 13, 29, 15, 31);
64916 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
64917 return __ret;
64918}
64419#define vmulxq_n_f16(__p0, __p1) __extension__ ({ \
64420 float16x8_t __ret; \
64421 float16x8_t __s0 = __p0; \
64422 float16_t __s1 = __p1; \
64423 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 7, 6, 5, 4, 3, 2, 1, 0); \
64424 __ret = __noswap_vmulxq_f16(__rev0, (float16x8_t) {__s1, __s1, __s1, __s1, __s1, __s1, __s1, __s1}); \
64425 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0); \
64426 __ret; \
64427})
6491964428#endif
6492064429
6492164430#ifdef __LITTLE_ENDIAN__
64922__ai float64x2_t vtrn2q_f64(float64x2_t __p0, float64x2_t __p1) {
64923 float64x2_t __ret;
64924 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
64925 return __ret;
64926}
64431#define vmulx_n_f16(__p0, __p1) __extension__ ({ \
64432 float16x4_t __ret; \
64433 float16x4_t __s0 = __p0; \
64434 float16_t __s1 = __p1; \
64435 __ret = vmulx_f16(__s0, (float16x4_t) {__s1, __s1, __s1, __s1}); \
64436 __ret; \
64437})
6492764438#else
64928__ai float64x2_t vtrn2q_f64(float64x2_t __p0, float64x2_t __p1) {
64929 float64x2_t __ret;
64930 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
64931 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
64932 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
64933 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
64934 return __ret;
64935}
64439#define vmulx_n_f16(__p0, __p1) __extension__ ({ \
64440 float16x4_t __ret; \
64441 float16x4_t __s0 = __p0; \
64442 float16_t __s1 = __p1; \
64443 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
64444 __ret = __noswap_vmulx_f16(__rev0, (float16x4_t) {__s1, __s1, __s1, __s1}); \
64445 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
64446 __ret; \
64447})
6493664448#endif
6493764449
6493864450#ifdef __LITTLE_ENDIAN__
64939__ai float32x4_t vtrn2q_f32(float32x4_t __p0, float32x4_t __p1) {
64940 float32x4_t __ret;
64941 __ret = __builtin_shufflevector(__p0, __p1, 1, 5, 3, 7);
64451__ai __attribute__((target("fullfp16"))) float16x8_t vpaddq_f16(float16x8_t __p0, float16x8_t __p1) {
64452 float16x8_t __ret;
64453 __ret = (float16x8_t) __builtin_neon_vpaddq_f16((int8x16_t)__p0, (int8x16_t)__p1, 40);
6494264454 return __ret;
6494364455}
6494464456#else
64945__ai float32x4_t vtrn2q_f32(float32x4_t __p0, float32x4_t __p1) {
64946 float32x4_t __ret;
64947 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
64948 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
64949 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 5, 3, 7);
64950 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
64457__ai __attribute__((target("fullfp16"))) float16x8_t vpaddq_f16(float16x8_t __p0, float16x8_t __p1) {
64458 float16x8_t __ret;
64459 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64460 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
64461 __ret = (float16x8_t) __builtin_neon_vpaddq_f16((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
64462 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6495164463 return __ret;
6495264464}
6495364465#endif
6495464466
6495564467#ifdef __LITTLE_ENDIAN__
64956__ai int32x4_t vtrn2q_s32(int32x4_t __p0, int32x4_t __p1) {
64957 int32x4_t __ret;
64958 __ret = __builtin_shufflevector(__p0, __p1, 1, 5, 3, 7);
64468__ai __attribute__((target("fullfp16"))) float16x8_t vpmaxq_f16(float16x8_t __p0, float16x8_t __p1) {
64469 float16x8_t __ret;
64470 __ret = (float16x8_t) __builtin_neon_vpmaxq_f16((int8x16_t)__p0, (int8x16_t)__p1, 40);
6495964471 return __ret;
6496064472}
6496164473#else
64962__ai int32x4_t vtrn2q_s32(int32x4_t __p0, int32x4_t __p1) {
64963 int32x4_t __ret;
64964 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
64965 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
64966 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 5, 3, 7);
64967 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
64474__ai __attribute__((target("fullfp16"))) float16x8_t vpmaxq_f16(float16x8_t __p0, float16x8_t __p1) {
64475 float16x8_t __ret;
64476 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64477 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
64478 __ret = (float16x8_t) __builtin_neon_vpmaxq_f16((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
64479 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6496864480 return __ret;
6496964481}
6497064482#endif
6497164483
6497264484#ifdef __LITTLE_ENDIAN__
64973__ai int64x2_t vtrn2q_s64(int64x2_t __p0, int64x2_t __p1) {
64974 int64x2_t __ret;
64975 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
64485__ai __attribute__((target("fullfp16"))) float16x8_t vpmaxnmq_f16(float16x8_t __p0, float16x8_t __p1) {
64486 float16x8_t __ret;
64487 __ret = (float16x8_t) __builtin_neon_vpmaxnmq_f16((int8x16_t)__p0, (int8x16_t)__p1, 40);
6497664488 return __ret;
6497764489}
6497864490#else
64979__ai int64x2_t vtrn2q_s64(int64x2_t __p0, int64x2_t __p1) {
64980 int64x2_t __ret;
64981 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
64982 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
64983 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
64984 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
64491__ai __attribute__((target("fullfp16"))) float16x8_t vpmaxnmq_f16(float16x8_t __p0, float16x8_t __p1) {
64492 float16x8_t __ret;
64493 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64494 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
64495 __ret = (float16x8_t) __builtin_neon_vpmaxnmq_f16((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
64496 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6498564497 return __ret;
6498664498}
6498764499#endif
6498864500
6498964501#ifdef __LITTLE_ENDIAN__
64990__ai int16x8_t vtrn2q_s16(int16x8_t __p0, int16x8_t __p1) {
64991 int16x8_t __ret;
64992 __ret = __builtin_shufflevector(__p0, __p1, 1, 9, 3, 11, 5, 13, 7, 15);
64502__ai __attribute__((target("fullfp16"))) float16x4_t vpmaxnm_f16(float16x4_t __p0, float16x4_t __p1) {
64503 float16x4_t __ret;
64504 __ret = (float16x4_t) __builtin_neon_vpmaxnm_f16((int8x8_t)__p0, (int8x8_t)__p1, 8);
6499364505 return __ret;
6499464506}
6499564507#else
64996__ai int16x8_t vtrn2q_s16(int16x8_t __p0, int16x8_t __p1) {
64997 int16x8_t __ret;
64998 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64999 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
65000 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 9, 3, 11, 5, 13, 7, 15);
65001 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
64508__ai __attribute__((target("fullfp16"))) float16x4_t vpmaxnm_f16(float16x4_t __p0, float16x4_t __p1) {
64509 float16x4_t __ret;
64510 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
64511 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
64512 __ret = (float16x4_t) __builtin_neon_vpmaxnm_f16((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
64513 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6500264514 return __ret;
6500364515}
6500464516#endif
6500564517
6500664518#ifdef __LITTLE_ENDIAN__
65007__ai uint8x8_t vtrn2_u8(uint8x8_t __p0, uint8x8_t __p1) {
65008 uint8x8_t __ret;
65009 __ret = __builtin_shufflevector(__p0, __p1, 1, 9, 3, 11, 5, 13, 7, 15);
64519__ai __attribute__((target("fullfp16"))) float16x8_t vpminq_f16(float16x8_t __p0, float16x8_t __p1) {
64520 float16x8_t __ret;
64521 __ret = (float16x8_t) __builtin_neon_vpminq_f16((int8x16_t)__p0, (int8x16_t)__p1, 40);
6501064522 return __ret;
6501164523}
6501264524#else
65013__ai uint8x8_t vtrn2_u8(uint8x8_t __p0, uint8x8_t __p1) {
65014 uint8x8_t __ret;
65015 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
65016 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
65017 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 9, 3, 11, 5, 13, 7, 15);
64525__ai __attribute__((target("fullfp16"))) float16x8_t vpminq_f16(float16x8_t __p0, float16x8_t __p1) {
64526 float16x8_t __ret;
64527 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64528 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
64529 __ret = (float16x8_t) __builtin_neon_vpminq_f16((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
6501864530 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6501964531 return __ret;
6502064532}
6502164533#endif
6502264534
6502364535#ifdef __LITTLE_ENDIAN__
65024__ai uint32x2_t vtrn2_u32(uint32x2_t __p0, uint32x2_t __p1) {
65025 uint32x2_t __ret;
65026 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
64536__ai __attribute__((target("fullfp16"))) float16x8_t vpminnmq_f16(float16x8_t __p0, float16x8_t __p1) {
64537 float16x8_t __ret;
64538 __ret = (float16x8_t) __builtin_neon_vpminnmq_f16((int8x16_t)__p0, (int8x16_t)__p1, 40);
6502764539 return __ret;
6502864540}
6502964541#else
65030__ai uint32x2_t vtrn2_u32(uint32x2_t __p0, uint32x2_t __p1) {
65031 uint32x2_t __ret;
65032 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
65033 uint32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
65034 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
65035 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
64542__ai __attribute__((target("fullfp16"))) float16x8_t vpminnmq_f16(float16x8_t __p0, float16x8_t __p1) {
64543 float16x8_t __ret;
64544 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64545 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
64546 __ret = (float16x8_t) __builtin_neon_vpminnmq_f16((int8x16_t)__rev0, (int8x16_t)__rev1, 40);
64547 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6503664548 return __ret;
6503764549}
6503864550#endif
6503964551
6504064552#ifdef __LITTLE_ENDIAN__
65041__ai uint16x4_t vtrn2_u16(uint16x4_t __p0, uint16x4_t __p1) {
65042 uint16x4_t __ret;
65043 __ret = __builtin_shufflevector(__p0, __p1, 1, 5, 3, 7);
64553__ai __attribute__((target("fullfp16"))) float16x4_t vpminnm_f16(float16x4_t __p0, float16x4_t __p1) {
64554 float16x4_t __ret;
64555 __ret = (float16x4_t) __builtin_neon_vpminnm_f16((int8x8_t)__p0, (int8x8_t)__p1, 8);
6504464556 return __ret;
6504564557}
6504664558#else
65047__ai uint16x4_t vtrn2_u16(uint16x4_t __p0, uint16x4_t __p1) {
65048 uint16x4_t __ret;
65049 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
65050 uint16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
65051 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 5, 3, 7);
64559__ai __attribute__((target("fullfp16"))) float16x4_t vpminnm_f16(float16x4_t __p0, float16x4_t __p1) {
64560 float16x4_t __ret;
64561 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
64562 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
64563 __ret = (float16x4_t) __builtin_neon_vpminnm_f16((int8x8_t)__rev0, (int8x8_t)__rev1, 8);
6505264564 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6505364565 return __ret;
6505464566}
6505564567#endif
6505664568
6505764569#ifdef __LITTLE_ENDIAN__
65058__ai int8x8_t vtrn2_s8(int8x8_t __p0, int8x8_t __p1) {
65059 int8x8_t __ret;
65060 __ret = __builtin_shufflevector(__p0, __p1, 1, 9, 3, 11, 5, 13, 7, 15);
64570__ai __attribute__((target("fullfp16"))) float16x8_t vrndiq_f16(float16x8_t __p0) {
64571 float16x8_t __ret;
64572 __ret = (float16x8_t) __builtin_neon_vrndiq_f16((int8x16_t)__p0, 40);
6506164573 return __ret;
6506264574}
6506364575#else
65064__ai int8x8_t vtrn2_s8(int8x8_t __p0, int8x8_t __p1) {
65065 int8x8_t __ret;
65066 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
65067 int8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
65068 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 9, 3, 11, 5, 13, 7, 15);
64576__ai __attribute__((target("fullfp16"))) float16x8_t vrndiq_f16(float16x8_t __p0) {
64577 float16x8_t __ret;
64578 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64579 __ret = (float16x8_t) __builtin_neon_vrndiq_f16((int8x16_t)__rev0, 40);
6506964580 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6507064581 return __ret;
6507164582}
6507264583#endif
6507364584
6507464585#ifdef __LITTLE_ENDIAN__
65075__ai float32x2_t vtrn2_f32(float32x2_t __p0, float32x2_t __p1) {
65076 float32x2_t __ret;
65077 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
64586__ai __attribute__((target("fullfp16"))) float16x4_t vrndi_f16(float16x4_t __p0) {
64587 float16x4_t __ret;
64588 __ret = (float16x4_t) __builtin_neon_vrndi_f16((int8x8_t)__p0, 8);
6507864589 return __ret;
6507964590}
6508064591#else
65081__ai float32x2_t vtrn2_f32(float32x2_t __p0, float32x2_t __p1) {
65082 float32x2_t __ret;
65083 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
65084 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
65085 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
65086 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
64592__ai __attribute__((target("fullfp16"))) float16x4_t vrndi_f16(float16x4_t __p0) {
64593 float16x4_t __ret;
64594 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
64595 __ret = (float16x4_t) __builtin_neon_vrndi_f16((int8x8_t)__rev0, 8);
64596 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6508764597 return __ret;
6508864598}
6508964599#endif
6509064600
6509164601#ifdef __LITTLE_ENDIAN__
65092__ai int32x2_t vtrn2_s32(int32x2_t __p0, int32x2_t __p1) {
65093 int32x2_t __ret;
65094 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
64602__ai __attribute__((target("fullfp16"))) float16x8_t vsqrtq_f16(float16x8_t __p0) {
64603 float16x8_t __ret;
64604 __ret = (float16x8_t) __builtin_neon_vsqrtq_f16((int8x16_t)__p0, 40);
6509564605 return __ret;
6509664606}
6509764607#else
65098__ai int32x2_t vtrn2_s32(int32x2_t __p0, int32x2_t __p1) {
65099 int32x2_t __ret;
65100 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
65101 int32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
65102 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
65103 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
64608__ai __attribute__((target("fullfp16"))) float16x8_t vsqrtq_f16(float16x8_t __p0) {
64609 float16x8_t __ret;
64610 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64611 __ret = (float16x8_t) __builtin_neon_vsqrtq_f16((int8x16_t)__rev0, 40);
64612 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6510464613 return __ret;
6510564614}
6510664615#endif
6510764616
6510864617#ifdef __LITTLE_ENDIAN__
65109__ai int16x4_t vtrn2_s16(int16x4_t __p0, int16x4_t __p1) {
65110 int16x4_t __ret;
65111 __ret = __builtin_shufflevector(__p0, __p1, 1, 5, 3, 7);
64618__ai __attribute__((target("fullfp16"))) float16x4_t vsqrt_f16(float16x4_t __p0) {
64619 float16x4_t __ret;
64620 __ret = (float16x4_t) __builtin_neon_vsqrt_f16((int8x8_t)__p0, 8);
6511264621 return __ret;
6511364622}
6511464623#else
65115__ai int16x4_t vtrn2_s16(int16x4_t __p0, int16x4_t __p1) {
65116 int16x4_t __ret;
65117 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
65118 int16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
65119 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 5, 3, 7);
64624__ai __attribute__((target("fullfp16"))) float16x4_t vsqrt_f16(float16x4_t __p0) {
64625 float16x4_t __ret;
64626 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
64627 __ret = (float16x4_t) __builtin_neon_vsqrt_f16((int8x8_t)__rev0, 8);
6512064628 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6512164629 return __ret;
6512264630}
6512364631#endif
6512464632
65125__ai uint64x1_t vtst_p64(poly64x1_t __p0, poly64x1_t __p1) {
65126 uint64x1_t __ret;
65127 __ret = (uint64x1_t) __builtin_neon_vtst_v((int8x8_t)__p0, (int8x8_t)__p1, 19);
65128 return __ret;
65129}
6513064633#ifdef __LITTLE_ENDIAN__
65131__ai uint64x2_t vtstq_p64(poly64x2_t __p0, poly64x2_t __p1) {
65132 uint64x2_t __ret;
65133 __ret = (uint64x2_t) __builtin_neon_vtstq_v((int8x16_t)__p0, (int8x16_t)__p1, 51);
64634__ai __attribute__((target("fullfp16"))) float16x8_t vtrn1q_f16(float16x8_t __p0, float16x8_t __p1) {
64635 float16x8_t __ret;
64636 __ret = __builtin_shufflevector(__p0, __p1, 0, 8, 2, 10, 4, 12, 6, 14);
6513464637 return __ret;
6513564638}
6513664639#else
65137__ai uint64x2_t vtstq_p64(poly64x2_t __p0, poly64x2_t __p1) {
65138 uint64x2_t __ret;
65139 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
65140 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
65141 __ret = (uint64x2_t) __builtin_neon_vtstq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 51);
65142 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
64640__ai __attribute__((target("fullfp16"))) float16x8_t vtrn1q_f16(float16x8_t __p0, float16x8_t __p1) {
64641 float16x8_t __ret;
64642 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64643 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
64644 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 8, 2, 10, 4, 12, 6, 14);
64645 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6514364646 return __ret;
6514464647}
6514564648#endif
6514664649
6514764650#ifdef __LITTLE_ENDIAN__
65148__ai uint64x2_t vtstq_u64(uint64x2_t __p0, uint64x2_t __p1) {
65149 uint64x2_t __ret;
65150 __ret = (uint64x2_t) __builtin_neon_vtstq_v((int8x16_t)__p0, (int8x16_t)__p1, 51);
64651__ai __attribute__((target("fullfp16"))) float16x4_t vtrn1_f16(float16x4_t __p0, float16x4_t __p1) {
64652 float16x4_t __ret;
64653 __ret = __builtin_shufflevector(__p0, __p1, 0, 4, 2, 6);
6515164654 return __ret;
6515264655}
6515364656#else
65154__ai uint64x2_t vtstq_u64(uint64x2_t __p0, uint64x2_t __p1) {
65155 uint64x2_t __ret;
65156 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
65157 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
65158 __ret = (uint64x2_t) __builtin_neon_vtstq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 51);
65159 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
64657__ai __attribute__((target("fullfp16"))) float16x4_t vtrn1_f16(float16x4_t __p0, float16x4_t __p1) {
64658 float16x4_t __ret;
64659 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
64660 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
64661 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 4, 2, 6);
64662 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6516064663 return __ret;
6516164664}
6516264665#endif
6516364666
6516464667#ifdef __LITTLE_ENDIAN__
65165__ai uint64x2_t vtstq_s64(int64x2_t __p0, int64x2_t __p1) {
65166 uint64x2_t __ret;
65167 __ret = (uint64x2_t) __builtin_neon_vtstq_v((int8x16_t)__p0, (int8x16_t)__p1, 51);
64668__ai __attribute__((target("fullfp16"))) float16x8_t vtrn2q_f16(float16x8_t __p0, float16x8_t __p1) {
64669 float16x8_t __ret;
64670 __ret = __builtin_shufflevector(__p0, __p1, 1, 9, 3, 11, 5, 13, 7, 15);
6516864671 return __ret;
6516964672}
6517064673#else
65171__ai uint64x2_t vtstq_s64(int64x2_t __p0, int64x2_t __p1) {
65172 uint64x2_t __ret;
65173 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
65174 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
65175 __ret = (uint64x2_t) __builtin_neon_vtstq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 51);
65176 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
64674__ai __attribute__((target("fullfp16"))) float16x8_t vtrn2q_f16(float16x8_t __p0, float16x8_t __p1) {
64675 float16x8_t __ret;
64676 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64677 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
64678 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 9, 3, 11, 5, 13, 7, 15);
64679 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6517764680 return __ret;
6517864681}
6517964682#endif
6518064683
65181__ai uint64x1_t vtst_u64(uint64x1_t __p0, uint64x1_t __p1) {
65182 uint64x1_t __ret;
65183 __ret = (uint64x1_t) __builtin_neon_vtst_v((int8x8_t)__p0, (int8x8_t)__p1, 19);
65184 return __ret;
65185}
65186__ai uint64x1_t vtst_s64(int64x1_t __p0, int64x1_t __p1) {
65187 uint64x1_t __ret;
65188 __ret = (uint64x1_t) __builtin_neon_vtst_v((int8x8_t)__p0, (int8x8_t)__p1, 19);
65189 return __ret;
65190}
65191__ai uint64_t vtstd_u64(uint64_t __p0, uint64_t __p1) {
65192 uint64_t __ret;
65193 __ret = (uint64_t) __builtin_neon_vtstd_u64(__p0, __p1);
65194 return __ret;
65195}
65196__ai uint64_t vtstd_s64(int64_t __p0, int64_t __p1) {
65197 uint64_t __ret;
65198 __ret = (uint64_t) __builtin_neon_vtstd_s64(__p0, __p1);
65199 return __ret;
65200}
65201__ai int8_t vuqaddb_s8(int8_t __p0, uint8_t __p1) {
65202 int8_t __ret;
65203 __ret = (int8_t) __builtin_neon_vuqaddb_s8(__p0, __p1);
65204 return __ret;
65205}
65206__ai int32_t vuqadds_s32(int32_t __p0, uint32_t __p1) {
65207 int32_t __ret;
65208 __ret = (int32_t) __builtin_neon_vuqadds_s32(__p0, __p1);
65209 return __ret;
65210}
65211__ai int64_t vuqaddd_s64(int64_t __p0, uint64_t __p1) {
65212 int64_t __ret;
65213 __ret = (int64_t) __builtin_neon_vuqaddd_s64(__p0, __p1);
65214 return __ret;
65215}
65216__ai int16_t vuqaddh_s16(int16_t __p0, uint16_t __p1) {
65217 int16_t __ret;
65218 __ret = (int16_t) __builtin_neon_vuqaddh_s16(__p0, __p1);
65219 return __ret;
65220}
6522164684#ifdef __LITTLE_ENDIAN__
65222__ai int8x16_t vuqaddq_s8(int8x16_t __p0, uint8x16_t __p1) {
65223 int8x16_t __ret;
65224 __ret = (int8x16_t) __builtin_neon_vuqaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 32);
64685__ai __attribute__((target("fullfp16"))) float16x4_t vtrn2_f16(float16x4_t __p0, float16x4_t __p1) {
64686 float16x4_t __ret;
64687 __ret = __builtin_shufflevector(__p0, __p1, 1, 5, 3, 7);
6522564688 return __ret;
6522664689}
6522764690#else
65228__ai int8x16_t vuqaddq_s8(int8x16_t __p0, uint8x16_t __p1) {
65229 int8x16_t __ret;
65230 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
65231 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
65232 __ret = (int8x16_t) __builtin_neon_vuqaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 32);
65233 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
64691__ai __attribute__((target("fullfp16"))) float16x4_t vtrn2_f16(float16x4_t __p0, float16x4_t __p1) {
64692 float16x4_t __ret;
64693 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
64694 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
64695 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 5, 3, 7);
64696 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6523464697 return __ret;
6523564698}
6523664699#endif
6523764700
6523864701#ifdef __LITTLE_ENDIAN__
65239__ai int32x4_t vuqaddq_s32(int32x4_t __p0, uint32x4_t __p1) {
65240 int32x4_t __ret;
65241 __ret = (int32x4_t) __builtin_neon_vuqaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 34);
64702__ai __attribute__((target("fullfp16"))) float16x8_t vuzp1q_f16(float16x8_t __p0, float16x8_t __p1) {
64703 float16x8_t __ret;
64704 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6, 8, 10, 12, 14);
6524264705 return __ret;
6524364706}
6524464707#else
65245__ai int32x4_t vuqaddq_s32(int32x4_t __p0, uint32x4_t __p1) {
65246 int32x4_t __ret;
65247 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
65248 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
65249 __ret = (int32x4_t) __builtin_neon_vuqaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 34);
65250 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
64708__ai __attribute__((target("fullfp16"))) float16x8_t vuzp1q_f16(float16x8_t __p0, float16x8_t __p1) {
64709 float16x8_t __ret;
64710 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64711 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
64712 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6, 8, 10, 12, 14);
64713 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6525164714 return __ret;
6525264715}
6525364716#endif
6525464717
6525564718#ifdef __LITTLE_ENDIAN__
65256__ai int64x2_t vuqaddq_s64(int64x2_t __p0, uint64x2_t __p1) {
65257 int64x2_t __ret;
65258 __ret = (int64x2_t) __builtin_neon_vuqaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 35);
64719__ai __attribute__((target("fullfp16"))) float16x4_t vuzp1_f16(float16x4_t __p0, float16x4_t __p1) {
64720 float16x4_t __ret;
64721 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6);
6525964722 return __ret;
6526064723}
6526164724#else
65262__ai int64x2_t vuqaddq_s64(int64x2_t __p0, uint64x2_t __p1) {
65263 int64x2_t __ret;
65264 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
65265 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
65266 __ret = (int64x2_t) __builtin_neon_vuqaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 35);
65267 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
64725__ai __attribute__((target("fullfp16"))) float16x4_t vuzp1_f16(float16x4_t __p0, float16x4_t __p1) {
64726 float16x4_t __ret;
64727 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
64728 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
64729 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6);
64730 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6526864731 return __ret;
6526964732}
6527064733#endif
6527164734
6527264735#ifdef __LITTLE_ENDIAN__
65273__ai int16x8_t vuqaddq_s16(int16x8_t __p0, uint16x8_t __p1) {
65274 int16x8_t __ret;
65275 __ret = (int16x8_t) __builtin_neon_vuqaddq_v((int8x16_t)__p0, (int8x16_t)__p1, 33);
64736__ai __attribute__((target("fullfp16"))) float16x8_t vuzp2q_f16(float16x8_t __p0, float16x8_t __p1) {
64737 float16x8_t __ret;
64738 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7, 9, 11, 13, 15);
6527664739 return __ret;
6527764740}
6527864741#else
65279__ai int16x8_t vuqaddq_s16(int16x8_t __p0, uint16x8_t __p1) {
65280 int16x8_t __ret;
65281 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
65282 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
65283 __ret = (int16x8_t) __builtin_neon_vuqaddq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 33);
64742__ai __attribute__((target("fullfp16"))) float16x8_t vuzp2q_f16(float16x8_t __p0, float16x8_t __p1) {
64743 float16x8_t __ret;
64744 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64745 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
64746 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7, 9, 11, 13, 15);
6528464747 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6528564748 return __ret;
6528664749}
6528764750#endif
6528864751
6528964752#ifdef __LITTLE_ENDIAN__
65290__ai int8x8_t vuqadd_s8(int8x8_t __p0, uint8x8_t __p1) {
65291 int8x8_t __ret;
65292 __ret = (int8x8_t) __builtin_neon_vuqadd_v((int8x8_t)__p0, (int8x8_t)__p1, 0);
64753__ai __attribute__((target("fullfp16"))) float16x4_t vuzp2_f16(float16x4_t __p0, float16x4_t __p1) {
64754 float16x4_t __ret;
64755 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7);
6529364756 return __ret;
6529464757}
6529564758#else
65296__ai int8x8_t vuqadd_s8(int8x8_t __p0, uint8x8_t __p1) {
65297 int8x8_t __ret;
65298 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
65299 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
65300 __ret = (int8x8_t) __builtin_neon_vuqadd_v((int8x8_t)__rev0, (int8x8_t)__rev1, 0);
65301 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
64759__ai __attribute__((target("fullfp16"))) float16x4_t vuzp2_f16(float16x4_t __p0, float16x4_t __p1) {
64760 float16x4_t __ret;
64761 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
64762 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
64763 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7);
64764 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6530264765 return __ret;
6530364766}
6530464767#endif
6530564768
6530664769#ifdef __LITTLE_ENDIAN__
65307__ai int32x2_t vuqadd_s32(int32x2_t __p0, uint32x2_t __p1) {
65308 int32x2_t __ret;
65309 __ret = (int32x2_t) __builtin_neon_vuqadd_v((int8x8_t)__p0, (int8x8_t)__p1, 2);
64770__ai __attribute__((target("fullfp16"))) float16x8_t vzip1q_f16(float16x8_t __p0, float16x8_t __p1) {
64771 float16x8_t __ret;
64772 __ret = __builtin_shufflevector(__p0, __p1, 0, 8, 1, 9, 2, 10, 3, 11);
6531064773 return __ret;
6531164774}
6531264775#else
65313__ai int32x2_t vuqadd_s32(int32x2_t __p0, uint32x2_t __p1) {
65314 int32x2_t __ret;
65315 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
65316 uint32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
65317 __ret = (int32x2_t) __builtin_neon_vuqadd_v((int8x8_t)__rev0, (int8x8_t)__rev1, 2);
65318 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
64776__ai __attribute__((target("fullfp16"))) float16x8_t vzip1q_f16(float16x8_t __p0, float16x8_t __p1) {
64777 float16x8_t __ret;
64778 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64779 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
64780 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 8, 1, 9, 2, 10, 3, 11);
64781 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6531964782 return __ret;
6532064783}
6532164784#endif
6532264785
65323__ai int64x1_t vuqadd_s64(int64x1_t __p0, uint64x1_t __p1) {
65324 int64x1_t __ret;
65325 __ret = (int64x1_t) __builtin_neon_vuqadd_v((int8x8_t)__p0, (int8x8_t)__p1, 3);
65326 return __ret;
65327}
6532864786#ifdef __LITTLE_ENDIAN__
65329__ai int16x4_t vuqadd_s16(int16x4_t __p0, uint16x4_t __p1) {
65330 int16x4_t __ret;
65331 __ret = (int16x4_t) __builtin_neon_vuqadd_v((int8x8_t)__p0, (int8x8_t)__p1, 1);
64787__ai __attribute__((target("fullfp16"))) float16x4_t vzip1_f16(float16x4_t __p0, float16x4_t __p1) {
64788 float16x4_t __ret;
64789 __ret = __builtin_shufflevector(__p0, __p1, 0, 4, 1, 5);
6533264790 return __ret;
6533364791}
6533464792#else
65335__ai int16x4_t vuqadd_s16(int16x4_t __p0, uint16x4_t __p1) {
65336 int16x4_t __ret;
65337 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
65338 uint16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
65339 __ret = (int16x4_t) __builtin_neon_vuqadd_v((int8x8_t)__rev0, (int8x8_t)__rev1, 1);
64793__ai __attribute__((target("fullfp16"))) float16x4_t vzip1_f16(float16x4_t __p0, float16x4_t __p1) {
64794 float16x4_t __ret;
64795 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
64796 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
64797 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 4, 1, 5);
6534064798 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6534164799 return __ret;
6534264800}
6534364801#endif
6534464802
6534564803#ifdef __LITTLE_ENDIAN__
65346#define vusdotq_laneq_s32(__p0_847, __p1_847, __p2_847, __p3_847) __extension__ ({ \
65347 int32x4_t __ret_847; \
65348 int32x4_t __s0_847 = __p0_847; \
65349 uint8x16_t __s1_847 = __p1_847; \
65350 int8x16_t __s2_847 = __p2_847; \
65351int8x16_t __reint_847 = __s2_847; \
65352 __ret_847 = vusdotq_s32(__s0_847, __s1_847, (int8x16_t)(splatq_laneq_s32(*(int32x4_t *) &__reint_847, __p3_847))); \
65353 __ret_847; \
65354})
65355#else
65356#define vusdotq_laneq_s32(__p0_848, __p1_848, __p2_848, __p3_848) __extension__ ({ \
65357 int32x4_t __ret_848; \
65358 int32x4_t __s0_848 = __p0_848; \
65359 uint8x16_t __s1_848 = __p1_848; \
65360 int8x16_t __s2_848 = __p2_848; \
65361 int32x4_t __rev0_848; __rev0_848 = __builtin_shufflevector(__s0_848, __s0_848, 3, 2, 1, 0); \
65362 uint8x16_t __rev1_848; __rev1_848 = __builtin_shufflevector(__s1_848, __s1_848, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
65363 int8x16_t __rev2_848; __rev2_848 = __builtin_shufflevector(__s2_848, __s2_848, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
65364int8x16_t __reint_848 = __rev2_848; \
65365 __ret_848 = __noswap_vusdotq_s32(__rev0_848, __rev1_848, (int8x16_t)(__noswap_splatq_laneq_s32(*(int32x4_t *) &__reint_848, __p3_848))); \
65366 __ret_848 = __builtin_shufflevector(__ret_848, __ret_848, 3, 2, 1, 0); \
65367 __ret_848; \
65368})
65369#endif
65370
65371#ifdef __LITTLE_ENDIAN__
65372#define vusdot_laneq_s32(__p0_849, __p1_849, __p2_849, __p3_849) __extension__ ({ \
65373 int32x2_t __ret_849; \
65374 int32x2_t __s0_849 = __p0_849; \
65375 uint8x8_t __s1_849 = __p1_849; \
65376 int8x16_t __s2_849 = __p2_849; \
65377int8x16_t __reint_849 = __s2_849; \
65378 __ret_849 = vusdot_s32(__s0_849, __s1_849, (int8x8_t)(splat_laneq_s32(*(int32x4_t *) &__reint_849, __p3_849))); \
65379 __ret_849; \
65380})
65381#else
65382#define vusdot_laneq_s32(__p0_850, __p1_850, __p2_850, __p3_850) __extension__ ({ \
65383 int32x2_t __ret_850; \
65384 int32x2_t __s0_850 = __p0_850; \
65385 uint8x8_t __s1_850 = __p1_850; \
65386 int8x16_t __s2_850 = __p2_850; \
65387 int32x2_t __rev0_850; __rev0_850 = __builtin_shufflevector(__s0_850, __s0_850, 1, 0); \
65388 uint8x8_t __rev1_850; __rev1_850 = __builtin_shufflevector(__s1_850, __s1_850, 7, 6, 5, 4, 3, 2, 1, 0); \
65389 int8x16_t __rev2_850; __rev2_850 = __builtin_shufflevector(__s2_850, __s2_850, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
65390int8x16_t __reint_850 = __rev2_850; \
65391 __ret_850 = __noswap_vusdot_s32(__rev0_850, __rev1_850, (int8x8_t)(__noswap_splat_laneq_s32(*(int32x4_t *) &__reint_850, __p3_850))); \
65392 __ret_850 = __builtin_shufflevector(__ret_850, __ret_850, 1, 0); \
65393 __ret_850; \
65394})
65395#endif
65396
65397#ifdef __LITTLE_ENDIAN__
65398__ai poly8x8_t vuzp1_p8(poly8x8_t __p0, poly8x8_t __p1) {
65399 poly8x8_t __ret;
65400 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6, 8, 10, 12, 14);
64804__ai __attribute__((target("fullfp16"))) float16x8_t vzip2q_f16(float16x8_t __p0, float16x8_t __p1) {
64805 float16x8_t __ret;
64806 __ret = __builtin_shufflevector(__p0, __p1, 4, 12, 5, 13, 6, 14, 7, 15);
6540164807 return __ret;
6540264808}
65403#else
65404__ai poly8x8_t vuzp1_p8(poly8x8_t __p0, poly8x8_t __p1) {
65405 poly8x8_t __ret;
65406 poly8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
65407 poly8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
65408 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6, 8, 10, 12, 14);
64809#else
64810__ai __attribute__((target("fullfp16"))) float16x8_t vzip2q_f16(float16x8_t __p0, float16x8_t __p1) {
64811 float16x8_t __ret;
64812 float16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
64813 float16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
64814 __ret = __builtin_shufflevector(__rev0, __rev1, 4, 12, 5, 13, 6, 14, 7, 15);
6540964815 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6541064816 return __ret;
6541164817}
6541264818#endif
6541364819
6541464820#ifdef __LITTLE_ENDIAN__
65415__ai poly16x4_t vuzp1_p16(poly16x4_t __p0, poly16x4_t __p1) {
65416 poly16x4_t __ret;
65417 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6);
64821__ai __attribute__((target("fullfp16"))) float16x4_t vzip2_f16(float16x4_t __p0, float16x4_t __p1) {
64822 float16x4_t __ret;
64823 __ret = __builtin_shufflevector(__p0, __p1, 2, 6, 3, 7);
6541864824 return __ret;
6541964825}
6542064826#else
65421__ai poly16x4_t vuzp1_p16(poly16x4_t __p0, poly16x4_t __p1) {
65422 poly16x4_t __ret;
65423 poly16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
65424 poly16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
65425 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6);
64827__ai __attribute__((target("fullfp16"))) float16x4_t vzip2_f16(float16x4_t __p0, float16x4_t __p1) {
64828 float16x4_t __ret;
64829 float16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
64830 float16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
64831 __ret = __builtin_shufflevector(__rev0, __rev1, 2, 6, 3, 7);
6542664832 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6542764833 return __ret;
6542864834}
6542964835#endif
6543064836
6543164837#ifdef __LITTLE_ENDIAN__
65432__ai poly8x16_t vuzp1q_p8(poly8x16_t __p0, poly8x16_t __p1) {
65433 poly8x16_t __ret;
65434 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6, 8, 10, 12, 14, 16, 18, 20, 22, 24, 26, 28, 30);
65435 return __ret;
65436}
64838#define vsudotq_laneq_s32(__p0_779, __p1_779, __p2_779, __p3_779) __extension__ ({ \
64839 int32x4_t __ret_779; \
64840 int32x4_t __s0_779 = __p0_779; \
64841 int8x16_t __s1_779 = __p1_779; \
64842 uint8x16_t __s2_779 = __p2_779; \
64843uint8x16_t __reint_779 = __s2_779; \
64844 __ret_779 = vusdotq_s32(__s0_779, (uint8x16_t)(splatq_laneq_s32(*(int32x4_t *) &__reint_779, __p3_779)), __s1_779); \
64845 __ret_779; \
64846})
6543764847#else
65438__ai poly8x16_t vuzp1q_p8(poly8x16_t __p0, poly8x16_t __p1) {
65439 poly8x16_t __ret;
65440 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
65441 poly8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
65442 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6, 8, 10, 12, 14, 16, 18, 20, 22, 24, 26, 28, 30);
65443 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
65444 return __ret;
65445}
64848#define vsudotq_laneq_s32(__p0_780, __p1_780, __p2_780, __p3_780) __extension__ ({ \
64849 int32x4_t __ret_780; \
64850 int32x4_t __s0_780 = __p0_780; \
64851 int8x16_t __s1_780 = __p1_780; \
64852 uint8x16_t __s2_780 = __p2_780; \
64853 int32x4_t __rev0_780; __rev0_780 = __builtin_shufflevector(__s0_780, __s0_780, 3, 2, 1, 0); \
64854 int8x16_t __rev1_780; __rev1_780 = __builtin_shufflevector(__s1_780, __s1_780, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
64855 uint8x16_t __rev2_780; __rev2_780 = __builtin_shufflevector(__s2_780, __s2_780, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
64856uint8x16_t __reint_780 = __rev2_780; \
64857 __ret_780 = __noswap_vusdotq_s32(__rev0_780, (uint8x16_t)(__noswap_splatq_laneq_s32(*(int32x4_t *) &__reint_780, __p3_780)), __rev1_780); \
64858 __ret_780 = __builtin_shufflevector(__ret_780, __ret_780, 3, 2, 1, 0); \
64859 __ret_780; \
64860})
6544664861#endif
6544764862
6544864863#ifdef __LITTLE_ENDIAN__
65449__ai poly64x2_t vuzp1q_p64(poly64x2_t __p0, poly64x2_t __p1) {
65450 poly64x2_t __ret;
65451 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
65452 return __ret;
65453}
64864#define vsudot_laneq_s32(__p0_781, __p1_781, __p2_781, __p3_781) __extension__ ({ \
64865 int32x2_t __ret_781; \
64866 int32x2_t __s0_781 = __p0_781; \
64867 int8x8_t __s1_781 = __p1_781; \
64868 uint8x16_t __s2_781 = __p2_781; \
64869uint8x16_t __reint_781 = __s2_781; \
64870 __ret_781 = vusdot_s32(__s0_781, (uint8x8_t)(splat_laneq_s32(*(int32x4_t *) &__reint_781, __p3_781)), __s1_781); \
64871 __ret_781; \
64872})
6545464873#else
65455__ai poly64x2_t vuzp1q_p64(poly64x2_t __p0, poly64x2_t __p1) {
65456 poly64x2_t __ret;
65457 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
65458 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
65459 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
65460 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
65461 return __ret;
65462}
64874#define vsudot_laneq_s32(__p0_782, __p1_782, __p2_782, __p3_782) __extension__ ({ \
64875 int32x2_t __ret_782; \
64876 int32x2_t __s0_782 = __p0_782; \
64877 int8x8_t __s1_782 = __p1_782; \
64878 uint8x16_t __s2_782 = __p2_782; \
64879 int32x2_t __rev0_782; __rev0_782 = __builtin_shufflevector(__s0_782, __s0_782, 1, 0); \
64880 int8x8_t __rev1_782; __rev1_782 = __builtin_shufflevector(__s1_782, __s1_782, 7, 6, 5, 4, 3, 2, 1, 0); \
64881 uint8x16_t __rev2_782; __rev2_782 = __builtin_shufflevector(__s2_782, __s2_782, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
64882uint8x16_t __reint_782 = __rev2_782; \
64883 __ret_782 = __noswap_vusdot_s32(__rev0_782, (uint8x8_t)(__noswap_splat_laneq_s32(*(int32x4_t *) &__reint_782, __p3_782)), __rev1_782); \
64884 __ret_782 = __builtin_shufflevector(__ret_782, __ret_782, 1, 0); \
64885 __ret_782; \
64886})
6546364887#endif
6546464888
6546564889#ifdef __LITTLE_ENDIAN__
65466__ai poly16x8_t vuzp1q_p16(poly16x8_t __p0, poly16x8_t __p1) {
65467 poly16x8_t __ret;
65468 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6, 8, 10, 12, 14);
65469 return __ret;
65470}
64890#define vusdotq_laneq_s32(__p0_783, __p1_783, __p2_783, __p3_783) __extension__ ({ \
64891 int32x4_t __ret_783; \
64892 int32x4_t __s0_783 = __p0_783; \
64893 uint8x16_t __s1_783 = __p1_783; \
64894 int8x16_t __s2_783 = __p2_783; \
64895int8x16_t __reint_783 = __s2_783; \
64896 __ret_783 = vusdotq_s32(__s0_783, __s1_783, (int8x16_t)(splatq_laneq_s32(*(int32x4_t *) &__reint_783, __p3_783))); \
64897 __ret_783; \
64898})
6547164899#else
65472__ai poly16x8_t vuzp1q_p16(poly16x8_t __p0, poly16x8_t __p1) {
65473 poly16x8_t __ret;
65474 poly16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
65475 poly16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
65476 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6, 8, 10, 12, 14);
65477 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
65478 return __ret;
65479}
64900#define vusdotq_laneq_s32(__p0_784, __p1_784, __p2_784, __p3_784) __extension__ ({ \
64901 int32x4_t __ret_784; \
64902 int32x4_t __s0_784 = __p0_784; \
64903 uint8x16_t __s1_784 = __p1_784; \
64904 int8x16_t __s2_784 = __p2_784; \
64905 int32x4_t __rev0_784; __rev0_784 = __builtin_shufflevector(__s0_784, __s0_784, 3, 2, 1, 0); \
64906 uint8x16_t __rev1_784; __rev1_784 = __builtin_shufflevector(__s1_784, __s1_784, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
64907 int8x16_t __rev2_784; __rev2_784 = __builtin_shufflevector(__s2_784, __s2_784, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
64908int8x16_t __reint_784 = __rev2_784; \
64909 __ret_784 = __noswap_vusdotq_s32(__rev0_784, __rev1_784, (int8x16_t)(__noswap_splatq_laneq_s32(*(int32x4_t *) &__reint_784, __p3_784))); \
64910 __ret_784 = __builtin_shufflevector(__ret_784, __ret_784, 3, 2, 1, 0); \
64911 __ret_784; \
64912})
6548064913#endif
6548164914
6548264915#ifdef __LITTLE_ENDIAN__
65483__ai uint8x16_t vuzp1q_u8(uint8x16_t __p0, uint8x16_t __p1) {
64916#define vusdot_laneq_s32(__p0_785, __p1_785, __p2_785, __p3_785) __extension__ ({ \
64917 int32x2_t __ret_785; \
64918 int32x2_t __s0_785 = __p0_785; \
64919 uint8x8_t __s1_785 = __p1_785; \
64920 int8x16_t __s2_785 = __p2_785; \
64921int8x16_t __reint_785 = __s2_785; \
64922 __ret_785 = vusdot_s32(__s0_785, __s1_785, (int8x8_t)(splat_laneq_s32(*(int32x4_t *) &__reint_785, __p3_785))); \
64923 __ret_785; \
64924})
64925#else
64926#define vusdot_laneq_s32(__p0_786, __p1_786, __p2_786, __p3_786) __extension__ ({ \
64927 int32x2_t __ret_786; \
64928 int32x2_t __s0_786 = __p0_786; \
64929 uint8x8_t __s1_786 = __p1_786; \
64930 int8x16_t __s2_786 = __p2_786; \
64931 int32x2_t __rev0_786; __rev0_786 = __builtin_shufflevector(__s0_786, __s0_786, 1, 0); \
64932 uint8x8_t __rev1_786; __rev1_786 = __builtin_shufflevector(__s1_786, __s1_786, 7, 6, 5, 4, 3, 2, 1, 0); \
64933 int8x16_t __rev2_786; __rev2_786 = __builtin_shufflevector(__s2_786, __s2_786, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
64934int8x16_t __reint_786 = __rev2_786; \
64935 __ret_786 = __noswap_vusdot_s32(__rev0_786, __rev1_786, (int8x8_t)(__noswap_splat_laneq_s32(*(int32x4_t *) &__reint_786, __p3_786))); \
64936 __ret_786 = __builtin_shufflevector(__ret_786, __ret_786, 1, 0); \
64937 __ret_786; \
64938})
64939#endif
64940
64941#ifdef __LITTLE_ENDIAN__
64942__ai __attribute__((target("sha3"))) uint8x16_t vbcaxq_u8(uint8x16_t __p0, uint8x16_t __p1, uint8x16_t __p2) {
6548464943 uint8x16_t __ret;
65485 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6, 8, 10, 12, 14, 16, 18, 20, 22, 24, 26, 28, 30);
64944 __ret = (uint8x16_t) __builtin_neon_vbcaxq_u8((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 48);
6548664945 return __ret;
6548764946}
6548864947#else
65489__ai uint8x16_t vuzp1q_u8(uint8x16_t __p0, uint8x16_t __p1) {
64948__ai __attribute__((target("sha3"))) uint8x16_t vbcaxq_u8(uint8x16_t __p0, uint8x16_t __p1, uint8x16_t __p2) {
6549064949 uint8x16_t __ret;
6549164950 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
6549264951 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
65493 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6, 8, 10, 12, 14, 16, 18, 20, 22, 24, 26, 28, 30);
64952 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
64953 __ret = (uint8x16_t) __builtin_neon_vbcaxq_u8((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 48);
6549464954 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
6549564955 return __ret;
6549664956}
6549764957#endif
6549864958
6549964959#ifdef __LITTLE_ENDIAN__
65500__ai uint32x4_t vuzp1q_u32(uint32x4_t __p0, uint32x4_t __p1) {
64960__ai __attribute__((target("sha3"))) uint32x4_t vbcaxq_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
6550164961 uint32x4_t __ret;
65502 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6);
64962 __ret = (uint32x4_t) __builtin_neon_vbcaxq_u32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 50);
6550364963 return __ret;
6550464964}
6550564965#else
65506__ai uint32x4_t vuzp1q_u32(uint32x4_t __p0, uint32x4_t __p1) {
64966__ai __attribute__((target("sha3"))) uint32x4_t vbcaxq_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
6550764967 uint32x4_t __ret;
6550864968 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
6550964969 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
65510 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6);
64970 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
64971 __ret = (uint32x4_t) __builtin_neon_vbcaxq_u32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 50);
6551164972 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6551264973 return __ret;
6551364974}
6551464975#endif
6551564976
6551664977#ifdef __LITTLE_ENDIAN__
65517__ai uint64x2_t vuzp1q_u64(uint64x2_t __p0, uint64x2_t __p1) {
64978__ai __attribute__((target("sha3"))) uint64x2_t vbcaxq_u64(uint64x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
6551864979 uint64x2_t __ret;
65519 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
64980 __ret = (uint64x2_t) __builtin_neon_vbcaxq_u64((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 51);
6552064981 return __ret;
6552164982}
6552264983#else
65523__ai uint64x2_t vuzp1q_u64(uint64x2_t __p0, uint64x2_t __p1) {
64984__ai __attribute__((target("sha3"))) uint64x2_t vbcaxq_u64(uint64x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
6552464985 uint64x2_t __ret;
6552564986 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
6552664987 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
65527 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
64988 uint64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
64989 __ret = (uint64x2_t) __builtin_neon_vbcaxq_u64((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 51);
6552864990 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6552964991 return __ret;
6553064992}
6553164993#endif
6553264994
6553364995#ifdef __LITTLE_ENDIAN__
65534__ai uint16x8_t vuzp1q_u16(uint16x8_t __p0, uint16x8_t __p1) {
64996__ai __attribute__((target("sha3"))) uint16x8_t vbcaxq_u16(uint16x8_t __p0, uint16x8_t __p1, uint16x8_t __p2) {
6553564997 uint16x8_t __ret;
65536 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6, 8, 10, 12, 14);
64998 __ret = (uint16x8_t) __builtin_neon_vbcaxq_u16((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 49);
6553764999 return __ret;
6553865000}
6553965001#else
65540__ai uint16x8_t vuzp1q_u16(uint16x8_t __p0, uint16x8_t __p1) {
65002__ai __attribute__((target("sha3"))) uint16x8_t vbcaxq_u16(uint16x8_t __p0, uint16x8_t __p1, uint16x8_t __p2) {
6554165003 uint16x8_t __ret;
6554265004 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
6554365005 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
65544 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6, 8, 10, 12, 14);
65006 uint16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
65007 __ret = (uint16x8_t) __builtin_neon_vbcaxq_u16((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 49);
6554565008 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6554665009 return __ret;
6554765010}
6554865011#endif
6554965012
6555065013#ifdef __LITTLE_ENDIAN__
65551__ai int8x16_t vuzp1q_s8(int8x16_t __p0, int8x16_t __p1) {
65014__ai __attribute__((target("sha3"))) int8x16_t vbcaxq_s8(int8x16_t __p0, int8x16_t __p1, int8x16_t __p2) {
6555265015 int8x16_t __ret;
65553 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6, 8, 10, 12, 14, 16, 18, 20, 22, 24, 26, 28, 30);
65016 __ret = (int8x16_t) __builtin_neon_vbcaxq_s8((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 32);
6555465017 return __ret;
6555565018}
6555665019#else
65557__ai int8x16_t vuzp1q_s8(int8x16_t __p0, int8x16_t __p1) {
65020__ai __attribute__((target("sha3"))) int8x16_t vbcaxq_s8(int8x16_t __p0, int8x16_t __p1, int8x16_t __p2) {
6555865021 int8x16_t __ret;
6555965022 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
6556065023 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
65561 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6, 8, 10, 12, 14, 16, 18, 20, 22, 24, 26, 28, 30);
65024 int8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
65025 __ret = (int8x16_t) __builtin_neon_vbcaxq_s8((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 32);
6556265026 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
6556365027 return __ret;
6556465028}
6556565029#endif
6556665030
6556765031#ifdef __LITTLE_ENDIAN__
65568__ai float64x2_t vuzp1q_f64(float64x2_t __p0, float64x2_t __p1) {
65569 float64x2_t __ret;
65570 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
65571 return __ret;
65572}
65573#else
65574__ai float64x2_t vuzp1q_f64(float64x2_t __p0, float64x2_t __p1) {
65575 float64x2_t __ret;
65576 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
65577 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
65578 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
65579 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
65580 return __ret;
65581}
65582#endif
65583
65584#ifdef __LITTLE_ENDIAN__
65585__ai float32x4_t vuzp1q_f32(float32x4_t __p0, float32x4_t __p1) {
65586 float32x4_t __ret;
65587 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6);
65588 return __ret;
65589}
65590#else
65591__ai float32x4_t vuzp1q_f32(float32x4_t __p0, float32x4_t __p1) {
65592 float32x4_t __ret;
65593 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
65594 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
65595 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6);
65596 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
65597 return __ret;
65598}
65599#endif
65600
65601#ifdef __LITTLE_ENDIAN__
65602__ai int32x4_t vuzp1q_s32(int32x4_t __p0, int32x4_t __p1) {
65032__ai __attribute__((target("sha3"))) int32x4_t vbcaxq_s32(int32x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
6560365033 int32x4_t __ret;
65604 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6);
65034 __ret = (int32x4_t) __builtin_neon_vbcaxq_s32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 34);
6560565035 return __ret;
6560665036}
6560765037#else
65608__ai int32x4_t vuzp1q_s32(int32x4_t __p0, int32x4_t __p1) {
65038__ai __attribute__((target("sha3"))) int32x4_t vbcaxq_s32(int32x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
6560965039 int32x4_t __ret;
6561065040 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
6561165041 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
65612 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6);
65042 int32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
65043 __ret = (int32x4_t) __builtin_neon_vbcaxq_s32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 34);
6561365044 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6561465045 return __ret;
6561565046}
6561665047#endif
6561765048
6561865049#ifdef __LITTLE_ENDIAN__
65619__ai int64x2_t vuzp1q_s64(int64x2_t __p0, int64x2_t __p1) {
65050__ai __attribute__((target("sha3"))) int64x2_t vbcaxq_s64(int64x2_t __p0, int64x2_t __p1, int64x2_t __p2) {
6562065051 int64x2_t __ret;
65621 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
65052 __ret = (int64x2_t) __builtin_neon_vbcaxq_s64((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 35);
6562265053 return __ret;
6562365054}
6562465055#else
65625__ai int64x2_t vuzp1q_s64(int64x2_t __p0, int64x2_t __p1) {
65056__ai __attribute__((target("sha3"))) int64x2_t vbcaxq_s64(int64x2_t __p0, int64x2_t __p1, int64x2_t __p2) {
6562665057 int64x2_t __ret;
6562765058 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
6562865059 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
65629 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
65060 int64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
65061 __ret = (int64x2_t) __builtin_neon_vbcaxq_s64((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 35);
6563065062 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6563165063 return __ret;
6563265064}
6563365065#endif
6563465066
6563565067#ifdef __LITTLE_ENDIAN__
65636__ai int16x8_t vuzp1q_s16(int16x8_t __p0, int16x8_t __p1) {
65068__ai __attribute__((target("sha3"))) int16x8_t vbcaxq_s16(int16x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
6563765069 int16x8_t __ret;
65638 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6, 8, 10, 12, 14);
65070 __ret = (int16x8_t) __builtin_neon_vbcaxq_s16((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 33);
6563965071 return __ret;
6564065072}
6564165073#else
65642__ai int16x8_t vuzp1q_s16(int16x8_t __p0, int16x8_t __p1) {
65074__ai __attribute__((target("sha3"))) int16x8_t vbcaxq_s16(int16x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
6564365075 int16x8_t __ret;
6564465076 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
6564565077 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
65646 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6, 8, 10, 12, 14);
65078 int16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
65079 __ret = (int16x8_t) __builtin_neon_vbcaxq_s16((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 33);
6564765080 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6564865081 return __ret;
6564965082}
6565065083#endif
6565165084
6565265085#ifdef __LITTLE_ENDIAN__
65653__ai uint8x8_t vuzp1_u8(uint8x8_t __p0, uint8x8_t __p1) {
65654 uint8x8_t __ret;
65655 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6, 8, 10, 12, 14);
65086__ai __attribute__((target("sha3"))) uint8x16_t veor3q_u8(uint8x16_t __p0, uint8x16_t __p1, uint8x16_t __p2) {
65087 uint8x16_t __ret;
65088 __ret = (uint8x16_t) __builtin_neon_veor3q_u8((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 48);
6565665089 return __ret;
6565765090}
6565865091#else
65659__ai uint8x8_t vuzp1_u8(uint8x8_t __p0, uint8x8_t __p1) {
65660 uint8x8_t __ret;
65661 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
65662 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
65663 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6, 8, 10, 12, 14);
65664 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
65092__ai __attribute__((target("sha3"))) uint8x16_t veor3q_u8(uint8x16_t __p0, uint8x16_t __p1, uint8x16_t __p2) {
65093 uint8x16_t __ret;
65094 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
65095 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
65096 uint8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
65097 __ret = (uint8x16_t) __builtin_neon_veor3q_u8((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 48);
65098 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
6566565099 return __ret;
6566665100}
6566765101#endif
6566865102
6566965103#ifdef __LITTLE_ENDIAN__
65670__ai uint32x2_t vuzp1_u32(uint32x2_t __p0, uint32x2_t __p1) {
65671 uint32x2_t __ret;
65672 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
65104__ai __attribute__((target("sha3"))) uint32x4_t veor3q_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
65105 uint32x4_t __ret;
65106 __ret = (uint32x4_t) __builtin_neon_veor3q_u32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 50);
6567365107 return __ret;
6567465108}
6567565109#else
65676__ai uint32x2_t vuzp1_u32(uint32x2_t __p0, uint32x2_t __p1) {
65677 uint32x2_t __ret;
65678 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
65679 uint32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
65680 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
65681 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
65110__ai __attribute__((target("sha3"))) uint32x4_t veor3q_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
65111 uint32x4_t __ret;
65112 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
65113 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
65114 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
65115 __ret = (uint32x4_t) __builtin_neon_veor3q_u32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 50);
65116 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6568265117 return __ret;
6568365118}
6568465119#endif
6568565120
6568665121#ifdef __LITTLE_ENDIAN__
65687__ai uint16x4_t vuzp1_u16(uint16x4_t __p0, uint16x4_t __p1) {
65688 uint16x4_t __ret;
65689 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6);
65122__ai __attribute__((target("sha3"))) uint64x2_t veor3q_u64(uint64x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
65123 uint64x2_t __ret;
65124 __ret = (uint64x2_t) __builtin_neon_veor3q_u64((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 51);
6569065125 return __ret;
6569165126}
6569265127#else
65693__ai uint16x4_t vuzp1_u16(uint16x4_t __p0, uint16x4_t __p1) {
65694 uint16x4_t __ret;
65695 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
65696 uint16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
65697 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6);
65698 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
65128__ai __attribute__((target("sha3"))) uint64x2_t veor3q_u64(uint64x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
65129 uint64x2_t __ret;
65130 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
65131 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
65132 uint64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
65133 __ret = (uint64x2_t) __builtin_neon_veor3q_u64((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 51);
65134 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6569965135 return __ret;
6570065136}
6570165137#endif
6570265138
6570365139#ifdef __LITTLE_ENDIAN__
65704__ai int8x8_t vuzp1_s8(int8x8_t __p0, int8x8_t __p1) {
65705 int8x8_t __ret;
65706 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6, 8, 10, 12, 14);
65140__ai __attribute__((target("sha3"))) uint16x8_t veor3q_u16(uint16x8_t __p0, uint16x8_t __p1, uint16x8_t __p2) {
65141 uint16x8_t __ret;
65142 __ret = (uint16x8_t) __builtin_neon_veor3q_u16((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 49);
6570765143 return __ret;
6570865144}
6570965145#else
65710__ai int8x8_t vuzp1_s8(int8x8_t __p0, int8x8_t __p1) {
65711 int8x8_t __ret;
65712 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
65713 int8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
65714 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6, 8, 10, 12, 14);
65146__ai __attribute__((target("sha3"))) uint16x8_t veor3q_u16(uint16x8_t __p0, uint16x8_t __p1, uint16x8_t __p2) {
65147 uint16x8_t __ret;
65148 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
65149 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
65150 uint16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
65151 __ret = (uint16x8_t) __builtin_neon_veor3q_u16((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 49);
6571565152 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6571665153 return __ret;
6571765154}
6571865155#endif
6571965156
6572065157#ifdef __LITTLE_ENDIAN__
65721__ai float32x2_t vuzp1_f32(float32x2_t __p0, float32x2_t __p1) {
65722 float32x2_t __ret;
65723 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
65158__ai __attribute__((target("sha3"))) int8x16_t veor3q_s8(int8x16_t __p0, int8x16_t __p1, int8x16_t __p2) {
65159 int8x16_t __ret;
65160 __ret = (int8x16_t) __builtin_neon_veor3q_s8((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 32);
6572465161 return __ret;
6572565162}
6572665163#else
65727__ai float32x2_t vuzp1_f32(float32x2_t __p0, float32x2_t __p1) {
65728 float32x2_t __ret;
65729 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
65730 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
65731 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
65732 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
65164__ai __attribute__((target("sha3"))) int8x16_t veor3q_s8(int8x16_t __p0, int8x16_t __p1, int8x16_t __p2) {
65165 int8x16_t __ret;
65166 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
65167 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
65168 int8x16_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
65169 __ret = (int8x16_t) __builtin_neon_veor3q_s8((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 32);
65170 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
6573365171 return __ret;
6573465172}
6573565173#endif
6573665174
6573765175#ifdef __LITTLE_ENDIAN__
65738__ai int32x2_t vuzp1_s32(int32x2_t __p0, int32x2_t __p1) {
65739 int32x2_t __ret;
65740 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
65176__ai __attribute__((target("sha3"))) int32x4_t veor3q_s32(int32x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
65177 int32x4_t __ret;
65178 __ret = (int32x4_t) __builtin_neon_veor3q_s32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 34);
6574165179 return __ret;
6574265180}
6574365181#else
65744__ai int32x2_t vuzp1_s32(int32x2_t __p0, int32x2_t __p1) {
65745 int32x2_t __ret;
65746 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
65747 int32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
65748 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
65749 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
65182__ai __attribute__((target("sha3"))) int32x4_t veor3q_s32(int32x4_t __p0, int32x4_t __p1, int32x4_t __p2) {
65183 int32x4_t __ret;
65184 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
65185 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
65186 int32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
65187 __ret = (int32x4_t) __builtin_neon_veor3q_s32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 34);
65188 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6575065189 return __ret;
6575165190}
6575265191#endif
6575365192
6575465193#ifdef __LITTLE_ENDIAN__
65755__ai int16x4_t vuzp1_s16(int16x4_t __p0, int16x4_t __p1) {
65756 int16x4_t __ret;
65757 __ret = __builtin_shufflevector(__p0, __p1, 0, 2, 4, 6);
65194__ai __attribute__((target("sha3"))) int64x2_t veor3q_s64(int64x2_t __p0, int64x2_t __p1, int64x2_t __p2) {
65195 int64x2_t __ret;
65196 __ret = (int64x2_t) __builtin_neon_veor3q_s64((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 35);
6575865197 return __ret;
6575965198}
6576065199#else
65761__ai int16x4_t vuzp1_s16(int16x4_t __p0, int16x4_t __p1) {
65762 int16x4_t __ret;
65763 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
65764 int16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
65765 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2, 4, 6);
65766 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
65200__ai __attribute__((target("sha3"))) int64x2_t veor3q_s64(int64x2_t __p0, int64x2_t __p1, int64x2_t __p2) {
65201 int64x2_t __ret;
65202 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
65203 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
65204 int64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
65205 __ret = (int64x2_t) __builtin_neon_veor3q_s64((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 35);
65206 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6576765207 return __ret;
6576865208}
6576965209#endif
6577065210
6577165211#ifdef __LITTLE_ENDIAN__
65772__ai poly8x8_t vuzp2_p8(poly8x8_t __p0, poly8x8_t __p1) {
65773 poly8x8_t __ret;
65774 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7, 9, 11, 13, 15);
65212__ai __attribute__((target("sha3"))) int16x8_t veor3q_s16(int16x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
65213 int16x8_t __ret;
65214 __ret = (int16x8_t) __builtin_neon_veor3q_s16((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 33);
6577565215 return __ret;
6577665216}
6577765217#else
65778__ai poly8x8_t vuzp2_p8(poly8x8_t __p0, poly8x8_t __p1) {
65779 poly8x8_t __ret;
65780 poly8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
65781 poly8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
65782 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7, 9, 11, 13, 15);
65218__ai __attribute__((target("sha3"))) int16x8_t veor3q_s16(int16x8_t __p0, int16x8_t __p1, int16x8_t __p2) {
65219 int16x8_t __ret;
65220 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
65221 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
65222 int16x8_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 7, 6, 5, 4, 3, 2, 1, 0);
65223 __ret = (int16x8_t) __builtin_neon_veor3q_s16((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 33);
6578365224 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
6578465225 return __ret;
6578565226}
6578665227#endif
6578765228
6578865229#ifdef __LITTLE_ENDIAN__
65789__ai poly16x4_t vuzp2_p16(poly16x4_t __p0, poly16x4_t __p1) {
65790 poly16x4_t __ret;
65791 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7);
65230__ai __attribute__((target("sha3"))) uint64x2_t vrax1q_u64(uint64x2_t __p0, uint64x2_t __p1) {
65231 uint64x2_t __ret;
65232 __ret = (uint64x2_t) __builtin_neon_vrax1q_u64((int8x16_t)__p0, (int8x16_t)__p1, 51);
6579265233 return __ret;
6579365234}
6579465235#else
65795__ai poly16x4_t vuzp2_p16(poly16x4_t __p0, poly16x4_t __p1) {
65796 poly16x4_t __ret;
65797 poly16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
65798 poly16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
65799 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7);
65800 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
65236__ai __attribute__((target("sha3"))) uint64x2_t vrax1q_u64(uint64x2_t __p0, uint64x2_t __p1) {
65237 uint64x2_t __ret;
65238 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
65239 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
65240 __ret = (uint64x2_t) __builtin_neon_vrax1q_u64((int8x16_t)__rev0, (int8x16_t)__rev1, 51);
65241 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6580165242 return __ret;
6580265243}
6580365244#endif
6580465245
6580565246#ifdef __LITTLE_ENDIAN__
65806__ai poly8x16_t vuzp2q_p8(poly8x16_t __p0, poly8x16_t __p1) {
65807 poly8x16_t __ret;
65808 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7, 9, 11, 13, 15, 17, 19, 21, 23, 25, 27, 29, 31);
65247__ai __attribute__((target("sha3"))) uint64x2_t vsha512hq_u64(uint64x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
65248 uint64x2_t __ret;
65249 __ret = (uint64x2_t) __builtin_neon_vsha512hq_u64((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 51);
6580965250 return __ret;
6581065251}
6581165252#else
65812__ai poly8x16_t vuzp2q_p8(poly8x16_t __p0, poly8x16_t __p1) {
65813 poly8x16_t __ret;
65814 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
65815 poly8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
65816 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7, 9, 11, 13, 15, 17, 19, 21, 23, 25, 27, 29, 31);
65817 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
65253__ai __attribute__((target("sha3"))) uint64x2_t vsha512hq_u64(uint64x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
65254 uint64x2_t __ret;
65255 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
65256 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
65257 uint64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
65258 __ret = (uint64x2_t) __builtin_neon_vsha512hq_u64((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 51);
65259 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6581865260 return __ret;
6581965261}
6582065262#endif
6582165263
6582265264#ifdef __LITTLE_ENDIAN__
65823__ai poly64x2_t vuzp2q_p64(poly64x2_t __p0, poly64x2_t __p1) {
65824 poly64x2_t __ret;
65825 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
65265__ai __attribute__((target("sha3"))) uint64x2_t vsha512h2q_u64(uint64x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
65266 uint64x2_t __ret;
65267 __ret = (uint64x2_t) __builtin_neon_vsha512h2q_u64((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 51);
6582665268 return __ret;
6582765269}
6582865270#else
65829__ai poly64x2_t vuzp2q_p64(poly64x2_t __p0, poly64x2_t __p1) {
65830 poly64x2_t __ret;
65831 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
65832 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
65833 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
65271__ai __attribute__((target("sha3"))) uint64x2_t vsha512h2q_u64(uint64x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
65272 uint64x2_t __ret;
65273 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
65274 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
65275 uint64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
65276 __ret = (uint64x2_t) __builtin_neon_vsha512h2q_u64((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 51);
6583465277 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6583565278 return __ret;
6583665279}
6583765280#endif
6583865281
6583965282#ifdef __LITTLE_ENDIAN__
65840__ai poly16x8_t vuzp2q_p16(poly16x8_t __p0, poly16x8_t __p1) {
65841 poly16x8_t __ret;
65842 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7, 9, 11, 13, 15);
65283__ai __attribute__((target("sha3"))) uint64x2_t vsha512su0q_u64(uint64x2_t __p0, uint64x2_t __p1) {
65284 uint64x2_t __ret;
65285 __ret = (uint64x2_t) __builtin_neon_vsha512su0q_u64((int8x16_t)__p0, (int8x16_t)__p1, 51);
6584365286 return __ret;
6584465287}
6584565288#else
65846__ai poly16x8_t vuzp2q_p16(poly16x8_t __p0, poly16x8_t __p1) {
65847 poly16x8_t __ret;
65848 poly16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
65849 poly16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
65850 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7, 9, 11, 13, 15);
65851 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
65289__ai __attribute__((target("sha3"))) uint64x2_t vsha512su0q_u64(uint64x2_t __p0, uint64x2_t __p1) {
65290 uint64x2_t __ret;
65291 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
65292 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
65293 __ret = (uint64x2_t) __builtin_neon_vsha512su0q_u64((int8x16_t)__rev0, (int8x16_t)__rev1, 51);
65294 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6585265295 return __ret;
6585365296}
6585465297#endif
6585565298
6585665299#ifdef __LITTLE_ENDIAN__
65857__ai uint8x16_t vuzp2q_u8(uint8x16_t __p0, uint8x16_t __p1) {
65858 uint8x16_t __ret;
65859 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7, 9, 11, 13, 15, 17, 19, 21, 23, 25, 27, 29, 31);
65300__ai __attribute__((target("sha3"))) uint64x2_t vsha512su1q_u64(uint64x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
65301 uint64x2_t __ret;
65302 __ret = (uint64x2_t) __builtin_neon_vsha512su1q_u64((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 51);
6586065303 return __ret;
6586165304}
6586265305#else
65863__ai uint8x16_t vuzp2q_u8(uint8x16_t __p0, uint8x16_t __p1) {
65864 uint8x16_t __ret;
65865 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
65866 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
65867 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7, 9, 11, 13, 15, 17, 19, 21, 23, 25, 27, 29, 31);
65868 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
65306__ai __attribute__((target("sha3"))) uint64x2_t vsha512su1q_u64(uint64x2_t __p0, uint64x2_t __p1, uint64x2_t __p2) {
65307 uint64x2_t __ret;
65308 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
65309 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
65310 uint64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
65311 __ret = (uint64x2_t) __builtin_neon_vsha512su1q_u64((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 51);
65312 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6586965313 return __ret;
6587065314}
6587165315#endif
6587265316
6587365317#ifdef __LITTLE_ENDIAN__
65874__ai uint32x4_t vuzp2q_u32(uint32x4_t __p0, uint32x4_t __p1) {
65318#define vxarq_u64(__p0, __p1, __p2) __extension__ ({ \
65319 uint64x2_t __ret; \
65320 uint64x2_t __s0 = __p0; \
65321 uint64x2_t __s1 = __p1; \
65322 __ret = (uint64x2_t) __builtin_neon_vxarq_u64((int8x16_t)__s0, (int8x16_t)__s1, __p2, 51); \
65323 __ret; \
65324})
65325#else
65326#define vxarq_u64(__p0, __p1, __p2) __extension__ ({ \
65327 uint64x2_t __ret; \
65328 uint64x2_t __s0 = __p0; \
65329 uint64x2_t __s1 = __p1; \
65330 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 1, 0); \
65331 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 1, 0); \
65332 __ret = (uint64x2_t) __builtin_neon_vxarq_u64((int8x16_t)__rev0, (int8x16_t)__rev1, __p2, 51); \
65333 __ret = __builtin_shufflevector(__ret, __ret, 1, 0); \
65334 __ret; \
65335})
65336#endif
65337
65338#ifdef __LITTLE_ENDIAN__
65339__ai __attribute__((target("sm4"))) uint32x4_t vsm3partw1q_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
6587565340 uint32x4_t __ret;
65876 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7);
65341 __ret = (uint32x4_t) __builtin_neon_vsm3partw1q_u32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 50);
6587765342 return __ret;
6587865343}
6587965344#else
65880__ai uint32x4_t vuzp2q_u32(uint32x4_t __p0, uint32x4_t __p1) {
65345__ai __attribute__((target("sm4"))) uint32x4_t vsm3partw1q_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
6588165346 uint32x4_t __ret;
6588265347 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
6588365348 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
65884 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7);
65349 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
65350 __ret = (uint32x4_t) __builtin_neon_vsm3partw1q_u32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 50);
6588565351 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6588665352 return __ret;
6588765353}
6588865354#endif
6588965355
6589065356#ifdef __LITTLE_ENDIAN__
65891__ai uint64x2_t vuzp2q_u64(uint64x2_t __p0, uint64x2_t __p1) {
65892 uint64x2_t __ret;
65893 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
65357__ai __attribute__((target("sm4"))) uint32x4_t vsm3partw2q_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
65358 uint32x4_t __ret;
65359 __ret = (uint32x4_t) __builtin_neon_vsm3partw2q_u32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 50);
6589465360 return __ret;
6589565361}
6589665362#else
65897__ai uint64x2_t vuzp2q_u64(uint64x2_t __p0, uint64x2_t __p1) {
65898 uint64x2_t __ret;
65899 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
65900 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
65901 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
65902 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
65363__ai __attribute__((target("sm4"))) uint32x4_t vsm3partw2q_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
65364 uint32x4_t __ret;
65365 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
65366 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
65367 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
65368 __ret = (uint32x4_t) __builtin_neon_vsm3partw2q_u32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 50);
65369 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6590365370 return __ret;
6590465371}
6590565372#endif
6590665373
6590765374#ifdef __LITTLE_ENDIAN__
65908__ai uint16x8_t vuzp2q_u16(uint16x8_t __p0, uint16x8_t __p1) {
65909 uint16x8_t __ret;
65910 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7, 9, 11, 13, 15);
65375__ai __attribute__((target("sm4"))) uint32x4_t vsm3ss1q_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
65376 uint32x4_t __ret;
65377 __ret = (uint32x4_t) __builtin_neon_vsm3ss1q_u32((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 50);
6591165378 return __ret;
6591265379}
6591365380#else
65914__ai uint16x8_t vuzp2q_u16(uint16x8_t __p0, uint16x8_t __p1) {
65915 uint16x8_t __ret;
65916 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
65917 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
65918 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7, 9, 11, 13, 15);
65919 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
65381__ai __attribute__((target("sm4"))) uint32x4_t vsm3ss1q_u32(uint32x4_t __p0, uint32x4_t __p1, uint32x4_t __p2) {
65382 uint32x4_t __ret;
65383 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
65384 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
65385 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 3, 2, 1, 0);
65386 __ret = (uint32x4_t) __builtin_neon_vsm3ss1q_u32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 50);
65387 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6592065388 return __ret;
6592165389}
6592265390#endif
6592365391
6592465392#ifdef __LITTLE_ENDIAN__
65925__ai int8x16_t vuzp2q_s8(int8x16_t __p0, int8x16_t __p1) {
65926 int8x16_t __ret;
65927 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7, 9, 11, 13, 15, 17, 19, 21, 23, 25, 27, 29, 31);
65928 return __ret;
65929}
65393#define vsm3tt1aq_u32(__p0, __p1, __p2, __p3) __extension__ ({ \
65394 uint32x4_t __ret; \
65395 uint32x4_t __s0 = __p0; \
65396 uint32x4_t __s1 = __p1; \
65397 uint32x4_t __s2 = __p2; \
65398 __ret = (uint32x4_t) __builtin_neon_vsm3tt1aq_u32((int8x16_t)__s0, (int8x16_t)__s1, (int8x16_t)__s2, __p3, 50); \
65399 __ret; \
65400})
6593065401#else
65931__ai int8x16_t vuzp2q_s8(int8x16_t __p0, int8x16_t __p1) {
65932 int8x16_t __ret;
65933 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
65934 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
65935 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7, 9, 11, 13, 15, 17, 19, 21, 23, 25, 27, 29, 31);
65936 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
65937 return __ret;
65938}
65402#define vsm3tt1aq_u32(__p0, __p1, __p2, __p3) __extension__ ({ \
65403 uint32x4_t __ret; \
65404 uint32x4_t __s0 = __p0; \
65405 uint32x4_t __s1 = __p1; \
65406 uint32x4_t __s2 = __p2; \
65407 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
65408 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
65409 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 3, 2, 1, 0); \
65410 __ret = (uint32x4_t) __builtin_neon_vsm3tt1aq_u32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, __p3, 50); \
65411 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
65412 __ret; \
65413})
6593965414#endif
6594065415
6594165416#ifdef __LITTLE_ENDIAN__
65942__ai float64x2_t vuzp2q_f64(float64x2_t __p0, float64x2_t __p1) {
65943 float64x2_t __ret;
65944 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
65945 return __ret;
65946}
65417#define vsm3tt1bq_u32(__p0, __p1, __p2, __p3) __extension__ ({ \
65418 uint32x4_t __ret; \
65419 uint32x4_t __s0 = __p0; \
65420 uint32x4_t __s1 = __p1; \
65421 uint32x4_t __s2 = __p2; \
65422 __ret = (uint32x4_t) __builtin_neon_vsm3tt1bq_u32((int8x16_t)__s0, (int8x16_t)__s1, (int8x16_t)__s2, __p3, 50); \
65423 __ret; \
65424})
6594765425#else
65948__ai float64x2_t vuzp2q_f64(float64x2_t __p0, float64x2_t __p1) {
65949 float64x2_t __ret;
65950 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
65951 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
65952 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
65953 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
65954 return __ret;
65955}
65426#define vsm3tt1bq_u32(__p0, __p1, __p2, __p3) __extension__ ({ \
65427 uint32x4_t __ret; \
65428 uint32x4_t __s0 = __p0; \
65429 uint32x4_t __s1 = __p1; \
65430 uint32x4_t __s2 = __p2; \
65431 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
65432 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
65433 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 3, 2, 1, 0); \
65434 __ret = (uint32x4_t) __builtin_neon_vsm3tt1bq_u32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, __p3, 50); \
65435 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
65436 __ret; \
65437})
6595665438#endif
6595765439
6595865440#ifdef __LITTLE_ENDIAN__
65959__ai float32x4_t vuzp2q_f32(float32x4_t __p0, float32x4_t __p1) {
65960 float32x4_t __ret;
65961 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7);
65962 return __ret;
65963}
65441#define vsm3tt2aq_u32(__p0, __p1, __p2, __p3) __extension__ ({ \
65442 uint32x4_t __ret; \
65443 uint32x4_t __s0 = __p0; \
65444 uint32x4_t __s1 = __p1; \
65445 uint32x4_t __s2 = __p2; \
65446 __ret = (uint32x4_t) __builtin_neon_vsm3tt2aq_u32((int8x16_t)__s0, (int8x16_t)__s1, (int8x16_t)__s2, __p3, 50); \
65447 __ret; \
65448})
6596465449#else
65965__ai float32x4_t vuzp2q_f32(float32x4_t __p0, float32x4_t __p1) {
65966 float32x4_t __ret;
65967 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
65968 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
65969 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7);
65970 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
65971 return __ret;
65972}
65450#define vsm3tt2aq_u32(__p0, __p1, __p2, __p3) __extension__ ({ \
65451 uint32x4_t __ret; \
65452 uint32x4_t __s0 = __p0; \
65453 uint32x4_t __s1 = __p1; \
65454 uint32x4_t __s2 = __p2; \
65455 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
65456 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
65457 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 3, 2, 1, 0); \
65458 __ret = (uint32x4_t) __builtin_neon_vsm3tt2aq_u32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, __p3, 50); \
65459 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
65460 __ret; \
65461})
65462#endif
65463
65464#ifdef __LITTLE_ENDIAN__
65465#define vsm3tt2bq_u32(__p0, __p1, __p2, __p3) __extension__ ({ \
65466 uint32x4_t __ret; \
65467 uint32x4_t __s0 = __p0; \
65468 uint32x4_t __s1 = __p1; \
65469 uint32x4_t __s2 = __p2; \
65470 __ret = (uint32x4_t) __builtin_neon_vsm3tt2bq_u32((int8x16_t)__s0, (int8x16_t)__s1, (int8x16_t)__s2, __p3, 50); \
65471 __ret; \
65472})
65473#else
65474#define vsm3tt2bq_u32(__p0, __p1, __p2, __p3) __extension__ ({ \
65475 uint32x4_t __ret; \
65476 uint32x4_t __s0 = __p0; \
65477 uint32x4_t __s1 = __p1; \
65478 uint32x4_t __s2 = __p2; \
65479 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__s0, __s0, 3, 2, 1, 0); \
65480 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__s1, __s1, 3, 2, 1, 0); \
65481 uint32x4_t __rev2; __rev2 = __builtin_shufflevector(__s2, __s2, 3, 2, 1, 0); \
65482 __ret = (uint32x4_t) __builtin_neon_vsm3tt2bq_u32((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, __p3, 50); \
65483 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0); \
65484 __ret; \
65485})
6597365486#endif
6597465487
6597565488#ifdef __LITTLE_ENDIAN__
65976__ai int32x4_t vuzp2q_s32(int32x4_t __p0, int32x4_t __p1) {
65977 int32x4_t __ret;
65978 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7);
65489__ai __attribute__((target("sm4"))) uint32x4_t vsm4eq_u32(uint32x4_t __p0, uint32x4_t __p1) {
65490 uint32x4_t __ret;
65491 __ret = (uint32x4_t) __builtin_neon_vsm4eq_u32((int8x16_t)__p0, (int8x16_t)__p1, 50);
6597965492 return __ret;
6598065493}
6598165494#else
65982__ai int32x4_t vuzp2q_s32(int32x4_t __p0, int32x4_t __p1) {
65983 int32x4_t __ret;
65984 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
65985 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
65986 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7);
65495__ai __attribute__((target("sm4"))) uint32x4_t vsm4eq_u32(uint32x4_t __p0, uint32x4_t __p1) {
65496 uint32x4_t __ret;
65497 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
65498 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
65499 __ret = (uint32x4_t) __builtin_neon_vsm4eq_u32((int8x16_t)__rev0, (int8x16_t)__rev1, 50);
6598765500 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6598865501 return __ret;
6598965502}
6599065503#endif
6599165504
6599265505#ifdef __LITTLE_ENDIAN__
65993__ai int64x2_t vuzp2q_s64(int64x2_t __p0, int64x2_t __p1) {
65994 int64x2_t __ret;
65995 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
65506__ai __attribute__((target("sm4"))) uint32x4_t vsm4ekeyq_u32(uint32x4_t __p0, uint32x4_t __p1) {
65507 uint32x4_t __ret;
65508 __ret = (uint32x4_t) __builtin_neon_vsm4ekeyq_u32((int8x16_t)__p0, (int8x16_t)__p1, 50);
6599665509 return __ret;
6599765510}
6599865511#else
65999__ai int64x2_t vuzp2q_s64(int64x2_t __p0, int64x2_t __p1) {
66000 int64x2_t __ret;
66001 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66002 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
66003 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
66004 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
65512__ai __attribute__((target("sm4"))) uint32x4_t vsm4ekeyq_u32(uint32x4_t __p0, uint32x4_t __p1) {
65513 uint32x4_t __ret;
65514 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
65515 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
65516 __ret = (uint32x4_t) __builtin_neon_vsm4ekeyq_u32((int8x16_t)__rev0, (int8x16_t)__rev1, 50);
65517 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6600565518 return __ret;
6600665519}
6600765520#endif
6600865521
66009#ifdef __LITTLE_ENDIAN__
66010__ai int16x8_t vuzp2q_s16(int16x8_t __p0, int16x8_t __p1) {
66011 int16x8_t __ret;
66012 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7, 9, 11, 13, 15);
65522__ai __attribute__((target("v8.1a"))) int32_t vqrdmlahs_s32(int32_t __p0, int32_t __p1, int32_t __p2) {
65523 int32_t __ret;
65524 __ret = (int32_t) __builtin_neon_vqrdmlahs_s32(__p0, __p1, __p2);
6601365525 return __ret;
6601465526}
66015#else
66016__ai int16x8_t vuzp2q_s16(int16x8_t __p0, int16x8_t __p1) {
66017 int16x8_t __ret;
66018 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
66019 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
66020 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7, 9, 11, 13, 15);
66021 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
65527__ai __attribute__((target("v8.1a"))) int16_t vqrdmlahh_s16(int16_t __p0, int16_t __p1, int16_t __p2) {
65528 int16_t __ret;
65529 __ret = (int16_t) __builtin_neon_vqrdmlahh_s16(__p0, __p1, __p2);
6602265530 return __ret;
6602365531}
66024#endif
66025
6602665532#ifdef __LITTLE_ENDIAN__
66027__ai uint8x8_t vuzp2_u8(uint8x8_t __p0, uint8x8_t __p1) {
66028 uint8x8_t __ret;
66029 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7, 9, 11, 13, 15);
66030 return __ret;
66031}
65533#define vqrdmlahs_lane_s32(__p0_787, __p1_787, __p2_787, __p3_787) __extension__ ({ \
65534 int32_t __ret_787; \
65535 int32_t __s0_787 = __p0_787; \
65536 int32_t __s1_787 = __p1_787; \
65537 int32x2_t __s2_787 = __p2_787; \
65538 __ret_787 = vqrdmlahs_s32(__s0_787, __s1_787, vget_lane_s32(__s2_787, __p3_787)); \
65539 __ret_787; \
65540})
6603265541#else
66033__ai uint8x8_t vuzp2_u8(uint8x8_t __p0, uint8x8_t __p1) {
66034 uint8x8_t __ret;
66035 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
66036 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
66037 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7, 9, 11, 13, 15);
66038 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
66039 return __ret;
66040}
65542#define vqrdmlahs_lane_s32(__p0_788, __p1_788, __p2_788, __p3_788) __extension__ ({ \
65543 int32_t __ret_788; \
65544 int32_t __s0_788 = __p0_788; \
65545 int32_t __s1_788 = __p1_788; \
65546 int32x2_t __s2_788 = __p2_788; \
65547 int32x2_t __rev2_788; __rev2_788 = __builtin_shufflevector(__s2_788, __s2_788, 1, 0); \
65548 __ret_788 = vqrdmlahs_s32(__s0_788, __s1_788, __noswap_vget_lane_s32(__rev2_788, __p3_788)); \
65549 __ret_788; \
65550})
6604165551#endif
6604265552
6604365553#ifdef __LITTLE_ENDIAN__
66044__ai uint32x2_t vuzp2_u32(uint32x2_t __p0, uint32x2_t __p1) {
66045 uint32x2_t __ret;
66046 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
66047 return __ret;
66048}
65554#define vqrdmlahh_lane_s16(__p0_789, __p1_789, __p2_789, __p3_789) __extension__ ({ \
65555 int16_t __ret_789; \
65556 int16_t __s0_789 = __p0_789; \
65557 int16_t __s1_789 = __p1_789; \
65558 int16x4_t __s2_789 = __p2_789; \
65559 __ret_789 = vqrdmlahh_s16(__s0_789, __s1_789, vget_lane_s16(__s2_789, __p3_789)); \
65560 __ret_789; \
65561})
6604965562#else
66050__ai uint32x2_t vuzp2_u32(uint32x2_t __p0, uint32x2_t __p1) {
66051 uint32x2_t __ret;
66052 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66053 uint32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
66054 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
66055 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
66056 return __ret;
66057}
65563#define vqrdmlahh_lane_s16(__p0_790, __p1_790, __p2_790, __p3_790) __extension__ ({ \
65564 int16_t __ret_790; \
65565 int16_t __s0_790 = __p0_790; \
65566 int16_t __s1_790 = __p1_790; \
65567 int16x4_t __s2_790 = __p2_790; \
65568 int16x4_t __rev2_790; __rev2_790 = __builtin_shufflevector(__s2_790, __s2_790, 3, 2, 1, 0); \
65569 __ret_790 = vqrdmlahh_s16(__s0_790, __s1_790, __noswap_vget_lane_s16(__rev2_790, __p3_790)); \
65570 __ret_790; \
65571})
6605865572#endif
6605965573
6606065574#ifdef __LITTLE_ENDIAN__
66061__ai uint16x4_t vuzp2_u16(uint16x4_t __p0, uint16x4_t __p1) {
66062 uint16x4_t __ret;
66063 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7);
66064 return __ret;
66065}
65575#define vqrdmlahs_laneq_s32(__p0_791, __p1_791, __p2_791, __p3_791) __extension__ ({ \
65576 int32_t __ret_791; \
65577 int32_t __s0_791 = __p0_791; \
65578 int32_t __s1_791 = __p1_791; \
65579 int32x4_t __s2_791 = __p2_791; \
65580 __ret_791 = vqrdmlahs_s32(__s0_791, __s1_791, vgetq_lane_s32(__s2_791, __p3_791)); \
65581 __ret_791; \
65582})
6606665583#else
66067__ai uint16x4_t vuzp2_u16(uint16x4_t __p0, uint16x4_t __p1) {
66068 uint16x4_t __ret;
66069 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
66070 uint16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
66071 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7);
66072 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
66073 return __ret;
66074}
65584#define vqrdmlahs_laneq_s32(__p0_792, __p1_792, __p2_792, __p3_792) __extension__ ({ \
65585 int32_t __ret_792; \
65586 int32_t __s0_792 = __p0_792; \
65587 int32_t __s1_792 = __p1_792; \
65588 int32x4_t __s2_792 = __p2_792; \
65589 int32x4_t __rev2_792; __rev2_792 = __builtin_shufflevector(__s2_792, __s2_792, 3, 2, 1, 0); \
65590 __ret_792 = vqrdmlahs_s32(__s0_792, __s1_792, __noswap_vgetq_lane_s32(__rev2_792, __p3_792)); \
65591 __ret_792; \
65592})
6607565593#endif
6607665594
6607765595#ifdef __LITTLE_ENDIAN__
66078__ai int8x8_t vuzp2_s8(int8x8_t __p0, int8x8_t __p1) {
66079 int8x8_t __ret;
66080 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7, 9, 11, 13, 15);
66081 return __ret;
66082}
65596#define vqrdmlahh_laneq_s16(__p0_793, __p1_793, __p2_793, __p3_793) __extension__ ({ \
65597 int16_t __ret_793; \
65598 int16_t __s0_793 = __p0_793; \
65599 int16_t __s1_793 = __p1_793; \
65600 int16x8_t __s2_793 = __p2_793; \
65601 __ret_793 = vqrdmlahh_s16(__s0_793, __s1_793, vgetq_lane_s16(__s2_793, __p3_793)); \
65602 __ret_793; \
65603})
6608365604#else
66084__ai int8x8_t vuzp2_s8(int8x8_t __p0, int8x8_t __p1) {
66085 int8x8_t __ret;
66086 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
66087 int8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
66088 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7, 9, 11, 13, 15);
66089 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
66090 return __ret;
66091}
65605#define vqrdmlahh_laneq_s16(__p0_794, __p1_794, __p2_794, __p3_794) __extension__ ({ \
65606 int16_t __ret_794; \
65607 int16_t __s0_794 = __p0_794; \
65608 int16_t __s1_794 = __p1_794; \
65609 int16x8_t __s2_794 = __p2_794; \
65610 int16x8_t __rev2_794; __rev2_794 = __builtin_shufflevector(__s2_794, __s2_794, 7, 6, 5, 4, 3, 2, 1, 0); \
65611 __ret_794 = vqrdmlahh_s16(__s0_794, __s1_794, __noswap_vgetq_lane_s16(__rev2_794, __p3_794)); \
65612 __ret_794; \
65613})
6609265614#endif
6609365615
6609465616#ifdef __LITTLE_ENDIAN__
66095__ai float32x2_t vuzp2_f32(float32x2_t __p0, float32x2_t __p1) {
66096 float32x2_t __ret;
66097 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
66098 return __ret;
66099}
65617#define vqrdmlahq_laneq_s32(__p0_795, __p1_795, __p2_795, __p3_795) __extension__ ({ \
65618 int32x4_t __ret_795; \
65619 int32x4_t __s0_795 = __p0_795; \
65620 int32x4_t __s1_795 = __p1_795; \
65621 int32x4_t __s2_795 = __p2_795; \
65622 __ret_795 = vqrdmlahq_s32(__s0_795, __s1_795, splatq_laneq_s32(__s2_795, __p3_795)); \
65623 __ret_795; \
65624})
6610065625#else
66101__ai float32x2_t vuzp2_f32(float32x2_t __p0, float32x2_t __p1) {
66102 float32x2_t __ret;
66103 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66104 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
66105 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
66106 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
66107 return __ret;
66108}
65626#define vqrdmlahq_laneq_s32(__p0_796, __p1_796, __p2_796, __p3_796) __extension__ ({ \
65627 int32x4_t __ret_796; \
65628 int32x4_t __s0_796 = __p0_796; \
65629 int32x4_t __s1_796 = __p1_796; \
65630 int32x4_t __s2_796 = __p2_796; \
65631 int32x4_t __rev0_796; __rev0_796 = __builtin_shufflevector(__s0_796, __s0_796, 3, 2, 1, 0); \
65632 int32x4_t __rev1_796; __rev1_796 = __builtin_shufflevector(__s1_796, __s1_796, 3, 2, 1, 0); \
65633 int32x4_t __rev2_796; __rev2_796 = __builtin_shufflevector(__s2_796, __s2_796, 3, 2, 1, 0); \
65634 __ret_796 = __noswap_vqrdmlahq_s32(__rev0_796, __rev1_796, __noswap_splatq_laneq_s32(__rev2_796, __p3_796)); \
65635 __ret_796 = __builtin_shufflevector(__ret_796, __ret_796, 3, 2, 1, 0); \
65636 __ret_796; \
65637})
6610965638#endif
6611065639
6611165640#ifdef __LITTLE_ENDIAN__
66112__ai int32x2_t vuzp2_s32(int32x2_t __p0, int32x2_t __p1) {
66113 int32x2_t __ret;
66114 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
66115 return __ret;
66116}
65641#define vqrdmlahq_laneq_s16(__p0_797, __p1_797, __p2_797, __p3_797) __extension__ ({ \
65642 int16x8_t __ret_797; \
65643 int16x8_t __s0_797 = __p0_797; \
65644 int16x8_t __s1_797 = __p1_797; \
65645 int16x8_t __s2_797 = __p2_797; \
65646 __ret_797 = vqrdmlahq_s16(__s0_797, __s1_797, splatq_laneq_s16(__s2_797, __p3_797)); \
65647 __ret_797; \
65648})
6611765649#else
66118__ai int32x2_t vuzp2_s32(int32x2_t __p0, int32x2_t __p1) {
66119 int32x2_t __ret;
66120 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66121 int32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
66122 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
66123 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
66124 return __ret;
66125}
65650#define vqrdmlahq_laneq_s16(__p0_798, __p1_798, __p2_798, __p3_798) __extension__ ({ \
65651 int16x8_t __ret_798; \
65652 int16x8_t __s0_798 = __p0_798; \
65653 int16x8_t __s1_798 = __p1_798; \
65654 int16x8_t __s2_798 = __p2_798; \
65655 int16x8_t __rev0_798; __rev0_798 = __builtin_shufflevector(__s0_798, __s0_798, 7, 6, 5, 4, 3, 2, 1, 0); \
65656 int16x8_t __rev1_798; __rev1_798 = __builtin_shufflevector(__s1_798, __s1_798, 7, 6, 5, 4, 3, 2, 1, 0); \
65657 int16x8_t __rev2_798; __rev2_798 = __builtin_shufflevector(__s2_798, __s2_798, 7, 6, 5, 4, 3, 2, 1, 0); \
65658 __ret_798 = __noswap_vqrdmlahq_s16(__rev0_798, __rev1_798, __noswap_splatq_laneq_s16(__rev2_798, __p3_798)); \
65659 __ret_798 = __builtin_shufflevector(__ret_798, __ret_798, 7, 6, 5, 4, 3, 2, 1, 0); \
65660 __ret_798; \
65661})
6612665662#endif
6612765663
6612865664#ifdef __LITTLE_ENDIAN__
66129__ai int16x4_t vuzp2_s16(int16x4_t __p0, int16x4_t __p1) {
66130 int16x4_t __ret;
66131 __ret = __builtin_shufflevector(__p0, __p1, 1, 3, 5, 7);
66132 return __ret;
66133}
65665#define vqrdmlah_laneq_s32(__p0_799, __p1_799, __p2_799, __p3_799) __extension__ ({ \
65666 int32x2_t __ret_799; \
65667 int32x2_t __s0_799 = __p0_799; \
65668 int32x2_t __s1_799 = __p1_799; \
65669 int32x4_t __s2_799 = __p2_799; \
65670 __ret_799 = vqrdmlah_s32(__s0_799, __s1_799, splat_laneq_s32(__s2_799, __p3_799)); \
65671 __ret_799; \
65672})
6613465673#else
66135__ai int16x4_t vuzp2_s16(int16x4_t __p0, int16x4_t __p1) {
66136 int16x4_t __ret;
66137 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
66138 int16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
66139 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3, 5, 7);
66140 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
66141 return __ret;
66142}
65674#define vqrdmlah_laneq_s32(__p0_800, __p1_800, __p2_800, __p3_800) __extension__ ({ \
65675 int32x2_t __ret_800; \
65676 int32x2_t __s0_800 = __p0_800; \
65677 int32x2_t __s1_800 = __p1_800; \
65678 int32x4_t __s2_800 = __p2_800; \
65679 int32x2_t __rev0_800; __rev0_800 = __builtin_shufflevector(__s0_800, __s0_800, 1, 0); \
65680 int32x2_t __rev1_800; __rev1_800 = __builtin_shufflevector(__s1_800, __s1_800, 1, 0); \
65681 int32x4_t __rev2_800; __rev2_800 = __builtin_shufflevector(__s2_800, __s2_800, 3, 2, 1, 0); \
65682 __ret_800 = __noswap_vqrdmlah_s32(__rev0_800, __rev1_800, __noswap_splat_laneq_s32(__rev2_800, __p3_800)); \
65683 __ret_800 = __builtin_shufflevector(__ret_800, __ret_800, 1, 0); \
65684 __ret_800; \
65685})
6614365686#endif
6614465687
6614565688#ifdef __LITTLE_ENDIAN__
66146__ai poly8x8_t vzip1_p8(poly8x8_t __p0, poly8x8_t __p1) {
66147 poly8x8_t __ret;
66148 __ret = __builtin_shufflevector(__p0, __p1, 0, 8, 1, 9, 2, 10, 3, 11);
66149 return __ret;
66150}
65689#define vqrdmlah_laneq_s16(__p0_801, __p1_801, __p2_801, __p3_801) __extension__ ({ \
65690 int16x4_t __ret_801; \
65691 int16x4_t __s0_801 = __p0_801; \
65692 int16x4_t __s1_801 = __p1_801; \
65693 int16x8_t __s2_801 = __p2_801; \
65694 __ret_801 = vqrdmlah_s16(__s0_801, __s1_801, splat_laneq_s16(__s2_801, __p3_801)); \
65695 __ret_801; \
65696})
6615165697#else
66152__ai poly8x8_t vzip1_p8(poly8x8_t __p0, poly8x8_t __p1) {
66153 poly8x8_t __ret;
66154 poly8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
66155 poly8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
66156 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 8, 1, 9, 2, 10, 3, 11);
66157 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
66158 return __ret;
66159}
65698#define vqrdmlah_laneq_s16(__p0_802, __p1_802, __p2_802, __p3_802) __extension__ ({ \
65699 int16x4_t __ret_802; \
65700 int16x4_t __s0_802 = __p0_802; \
65701 int16x4_t __s1_802 = __p1_802; \
65702 int16x8_t __s2_802 = __p2_802; \
65703 int16x4_t __rev0_802; __rev0_802 = __builtin_shufflevector(__s0_802, __s0_802, 3, 2, 1, 0); \
65704 int16x4_t __rev1_802; __rev1_802 = __builtin_shufflevector(__s1_802, __s1_802, 3, 2, 1, 0); \
65705 int16x8_t __rev2_802; __rev2_802 = __builtin_shufflevector(__s2_802, __s2_802, 7, 6, 5, 4, 3, 2, 1, 0); \
65706 __ret_802 = __noswap_vqrdmlah_s16(__rev0_802, __rev1_802, __noswap_splat_laneq_s16(__rev2_802, __p3_802)); \
65707 __ret_802 = __builtin_shufflevector(__ret_802, __ret_802, 3, 2, 1, 0); \
65708 __ret_802; \
65709})
6616065710#endif
6616165711
66162#ifdef __LITTLE_ENDIAN__
66163__ai poly16x4_t vzip1_p16(poly16x4_t __p0, poly16x4_t __p1) {
66164 poly16x4_t __ret;
66165 __ret = __builtin_shufflevector(__p0, __p1, 0, 4, 1, 5);
65712__ai __attribute__((target("v8.1a"))) int32_t vqrdmlshs_s32(int32_t __p0, int32_t __p1, int32_t __p2) {
65713 int32_t __ret;
65714 __ret = (int32_t) __builtin_neon_vqrdmlshs_s32(__p0, __p1, __p2);
6616665715 return __ret;
6616765716}
66168#else
66169__ai poly16x4_t vzip1_p16(poly16x4_t __p0, poly16x4_t __p1) {
66170 poly16x4_t __ret;
66171 poly16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
66172 poly16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
66173 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 4, 1, 5);
66174 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
65717__ai __attribute__((target("v8.1a"))) int16_t vqrdmlshh_s16(int16_t __p0, int16_t __p1, int16_t __p2) {
65718 int16_t __ret;
65719 __ret = (int16_t) __builtin_neon_vqrdmlshh_s16(__p0, __p1, __p2);
6617565720 return __ret;
6617665721}
65722#ifdef __LITTLE_ENDIAN__
65723#define vqrdmlshs_lane_s32(__p0_803, __p1_803, __p2_803, __p3_803) __extension__ ({ \
65724 int32_t __ret_803; \
65725 int32_t __s0_803 = __p0_803; \
65726 int32_t __s1_803 = __p1_803; \
65727 int32x2_t __s2_803 = __p2_803; \
65728 __ret_803 = vqrdmlshs_s32(__s0_803, __s1_803, vget_lane_s32(__s2_803, __p3_803)); \
65729 __ret_803; \
65730})
65731#else
65732#define vqrdmlshs_lane_s32(__p0_804, __p1_804, __p2_804, __p3_804) __extension__ ({ \
65733 int32_t __ret_804; \
65734 int32_t __s0_804 = __p0_804; \
65735 int32_t __s1_804 = __p1_804; \
65736 int32x2_t __s2_804 = __p2_804; \
65737 int32x2_t __rev2_804; __rev2_804 = __builtin_shufflevector(__s2_804, __s2_804, 1, 0); \
65738 __ret_804 = vqrdmlshs_s32(__s0_804, __s1_804, __noswap_vget_lane_s32(__rev2_804, __p3_804)); \
65739 __ret_804; \
65740})
6617765741#endif
6617865742
6617965743#ifdef __LITTLE_ENDIAN__
66180__ai poly8x16_t vzip1q_p8(poly8x16_t __p0, poly8x16_t __p1) {
66181 poly8x16_t __ret;
66182 __ret = __builtin_shufflevector(__p0, __p1, 0, 16, 1, 17, 2, 18, 3, 19, 4, 20, 5, 21, 6, 22, 7, 23);
66183 return __ret;
66184}
65744#define vqrdmlshh_lane_s16(__p0_805, __p1_805, __p2_805, __p3_805) __extension__ ({ \
65745 int16_t __ret_805; \
65746 int16_t __s0_805 = __p0_805; \
65747 int16_t __s1_805 = __p1_805; \
65748 int16x4_t __s2_805 = __p2_805; \
65749 __ret_805 = vqrdmlshh_s16(__s0_805, __s1_805, vget_lane_s16(__s2_805, __p3_805)); \
65750 __ret_805; \
65751})
6618565752#else
66186__ai poly8x16_t vzip1q_p8(poly8x16_t __p0, poly8x16_t __p1) {
66187 poly8x16_t __ret;
66188 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
66189 poly8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
66190 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 16, 1, 17, 2, 18, 3, 19, 4, 20, 5, 21, 6, 22, 7, 23);
66191 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
66192 return __ret;
66193}
65753#define vqrdmlshh_lane_s16(__p0_806, __p1_806, __p2_806, __p3_806) __extension__ ({ \
65754 int16_t __ret_806; \
65755 int16_t __s0_806 = __p0_806; \
65756 int16_t __s1_806 = __p1_806; \
65757 int16x4_t __s2_806 = __p2_806; \
65758 int16x4_t __rev2_806; __rev2_806 = __builtin_shufflevector(__s2_806, __s2_806, 3, 2, 1, 0); \
65759 __ret_806 = vqrdmlshh_s16(__s0_806, __s1_806, __noswap_vget_lane_s16(__rev2_806, __p3_806)); \
65760 __ret_806; \
65761})
6619465762#endif
6619565763
6619665764#ifdef __LITTLE_ENDIAN__
66197__ai poly64x2_t vzip1q_p64(poly64x2_t __p0, poly64x2_t __p1) {
66198 poly64x2_t __ret;
66199 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
66200 return __ret;
66201}
65765#define vqrdmlshs_laneq_s32(__p0_807, __p1_807, __p2_807, __p3_807) __extension__ ({ \
65766 int32_t __ret_807; \
65767 int32_t __s0_807 = __p0_807; \
65768 int32_t __s1_807 = __p1_807; \
65769 int32x4_t __s2_807 = __p2_807; \
65770 __ret_807 = vqrdmlshs_s32(__s0_807, __s1_807, vgetq_lane_s32(__s2_807, __p3_807)); \
65771 __ret_807; \
65772})
6620265773#else
66203__ai poly64x2_t vzip1q_p64(poly64x2_t __p0, poly64x2_t __p1) {
66204 poly64x2_t __ret;
66205 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66206 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
66207 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
66208 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
66209 return __ret;
66210}
65774#define vqrdmlshs_laneq_s32(__p0_808, __p1_808, __p2_808, __p3_808) __extension__ ({ \
65775 int32_t __ret_808; \
65776 int32_t __s0_808 = __p0_808; \
65777 int32_t __s1_808 = __p1_808; \
65778 int32x4_t __s2_808 = __p2_808; \
65779 int32x4_t __rev2_808; __rev2_808 = __builtin_shufflevector(__s2_808, __s2_808, 3, 2, 1, 0); \
65780 __ret_808 = vqrdmlshs_s32(__s0_808, __s1_808, __noswap_vgetq_lane_s32(__rev2_808, __p3_808)); \
65781 __ret_808; \
65782})
6621165783#endif
6621265784
6621365785#ifdef __LITTLE_ENDIAN__
66214__ai poly16x8_t vzip1q_p16(poly16x8_t __p0, poly16x8_t __p1) {
66215 poly16x8_t __ret;
66216 __ret = __builtin_shufflevector(__p0, __p1, 0, 8, 1, 9, 2, 10, 3, 11);
66217 return __ret;
66218}
65786#define vqrdmlshh_laneq_s16(__p0_809, __p1_809, __p2_809, __p3_809) __extension__ ({ \
65787 int16_t __ret_809; \
65788 int16_t __s0_809 = __p0_809; \
65789 int16_t __s1_809 = __p1_809; \
65790 int16x8_t __s2_809 = __p2_809; \
65791 __ret_809 = vqrdmlshh_s16(__s0_809, __s1_809, vgetq_lane_s16(__s2_809, __p3_809)); \
65792 __ret_809; \
65793})
6621965794#else
66220__ai poly16x8_t vzip1q_p16(poly16x8_t __p0, poly16x8_t __p1) {
66221 poly16x8_t __ret;
66222 poly16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
66223 poly16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
66224 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 8, 1, 9, 2, 10, 3, 11);
66225 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
66226 return __ret;
66227}
65795#define vqrdmlshh_laneq_s16(__p0_810, __p1_810, __p2_810, __p3_810) __extension__ ({ \
65796 int16_t __ret_810; \
65797 int16_t __s0_810 = __p0_810; \
65798 int16_t __s1_810 = __p1_810; \
65799 int16x8_t __s2_810 = __p2_810; \
65800 int16x8_t __rev2_810; __rev2_810 = __builtin_shufflevector(__s2_810, __s2_810, 7, 6, 5, 4, 3, 2, 1, 0); \
65801 __ret_810 = vqrdmlshh_s16(__s0_810, __s1_810, __noswap_vgetq_lane_s16(__rev2_810, __p3_810)); \
65802 __ret_810; \
65803})
6622865804#endif
6622965805
6623065806#ifdef __LITTLE_ENDIAN__
66231__ai uint8x16_t vzip1q_u8(uint8x16_t __p0, uint8x16_t __p1) {
66232 uint8x16_t __ret;
66233 __ret = __builtin_shufflevector(__p0, __p1, 0, 16, 1, 17, 2, 18, 3, 19, 4, 20, 5, 21, 6, 22, 7, 23);
66234 return __ret;
66235}
65807#define vqrdmlshq_laneq_s32(__p0_811, __p1_811, __p2_811, __p3_811) __extension__ ({ \
65808 int32x4_t __ret_811; \
65809 int32x4_t __s0_811 = __p0_811; \
65810 int32x4_t __s1_811 = __p1_811; \
65811 int32x4_t __s2_811 = __p2_811; \
65812 __ret_811 = vqrdmlshq_s32(__s0_811, __s1_811, splatq_laneq_s32(__s2_811, __p3_811)); \
65813 __ret_811; \
65814})
6623665815#else
66237__ai uint8x16_t vzip1q_u8(uint8x16_t __p0, uint8x16_t __p1) {
66238 uint8x16_t __ret;
66239 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
66240 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
66241 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 16, 1, 17, 2, 18, 3, 19, 4, 20, 5, 21, 6, 22, 7, 23);
66242 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
66243 return __ret;
66244}
65816#define vqrdmlshq_laneq_s32(__p0_812, __p1_812, __p2_812, __p3_812) __extension__ ({ \
65817 int32x4_t __ret_812; \
65818 int32x4_t __s0_812 = __p0_812; \
65819 int32x4_t __s1_812 = __p1_812; \
65820 int32x4_t __s2_812 = __p2_812; \
65821 int32x4_t __rev0_812; __rev0_812 = __builtin_shufflevector(__s0_812, __s0_812, 3, 2, 1, 0); \
65822 int32x4_t __rev1_812; __rev1_812 = __builtin_shufflevector(__s1_812, __s1_812, 3, 2, 1, 0); \
65823 int32x4_t __rev2_812; __rev2_812 = __builtin_shufflevector(__s2_812, __s2_812, 3, 2, 1, 0); \
65824 __ret_812 = __noswap_vqrdmlshq_s32(__rev0_812, __rev1_812, __noswap_splatq_laneq_s32(__rev2_812, __p3_812)); \
65825 __ret_812 = __builtin_shufflevector(__ret_812, __ret_812, 3, 2, 1, 0); \
65826 __ret_812; \
65827})
6624565828#endif
6624665829
6624765830#ifdef __LITTLE_ENDIAN__
66248__ai uint32x4_t vzip1q_u32(uint32x4_t __p0, uint32x4_t __p1) {
66249 uint32x4_t __ret;
66250 __ret = __builtin_shufflevector(__p0, __p1, 0, 4, 1, 5);
66251 return __ret;
66252}
65831#define vqrdmlshq_laneq_s16(__p0_813, __p1_813, __p2_813, __p3_813) __extension__ ({ \
65832 int16x8_t __ret_813; \
65833 int16x8_t __s0_813 = __p0_813; \
65834 int16x8_t __s1_813 = __p1_813; \
65835 int16x8_t __s2_813 = __p2_813; \
65836 __ret_813 = vqrdmlshq_s16(__s0_813, __s1_813, splatq_laneq_s16(__s2_813, __p3_813)); \
65837 __ret_813; \
65838})
6625365839#else
66254__ai uint32x4_t vzip1q_u32(uint32x4_t __p0, uint32x4_t __p1) {
66255 uint32x4_t __ret;
66256 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
66257 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
66258 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 4, 1, 5);
66259 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
66260 return __ret;
66261}
65840#define vqrdmlshq_laneq_s16(__p0_814, __p1_814, __p2_814, __p3_814) __extension__ ({ \
65841 int16x8_t __ret_814; \
65842 int16x8_t __s0_814 = __p0_814; \
65843 int16x8_t __s1_814 = __p1_814; \
65844 int16x8_t __s2_814 = __p2_814; \
65845 int16x8_t __rev0_814; __rev0_814 = __builtin_shufflevector(__s0_814, __s0_814, 7, 6, 5, 4, 3, 2, 1, 0); \
65846 int16x8_t __rev1_814; __rev1_814 = __builtin_shufflevector(__s1_814, __s1_814, 7, 6, 5, 4, 3, 2, 1, 0); \
65847 int16x8_t __rev2_814; __rev2_814 = __builtin_shufflevector(__s2_814, __s2_814, 7, 6, 5, 4, 3, 2, 1, 0); \
65848 __ret_814 = __noswap_vqrdmlshq_s16(__rev0_814, __rev1_814, __noswap_splatq_laneq_s16(__rev2_814, __p3_814)); \
65849 __ret_814 = __builtin_shufflevector(__ret_814, __ret_814, 7, 6, 5, 4, 3, 2, 1, 0); \
65850 __ret_814; \
65851})
6626265852#endif
6626365853
6626465854#ifdef __LITTLE_ENDIAN__
66265__ai uint64x2_t vzip1q_u64(uint64x2_t __p0, uint64x2_t __p1) {
66266 uint64x2_t __ret;
66267 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
66268 return __ret;
66269}
65855#define vqrdmlsh_laneq_s32(__p0_815, __p1_815, __p2_815, __p3_815) __extension__ ({ \
65856 int32x2_t __ret_815; \
65857 int32x2_t __s0_815 = __p0_815; \
65858 int32x2_t __s1_815 = __p1_815; \
65859 int32x4_t __s2_815 = __p2_815; \
65860 __ret_815 = vqrdmlsh_s32(__s0_815, __s1_815, splat_laneq_s32(__s2_815, __p3_815)); \
65861 __ret_815; \
65862})
6627065863#else
66271__ai uint64x2_t vzip1q_u64(uint64x2_t __p0, uint64x2_t __p1) {
66272 uint64x2_t __ret;
66273 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66274 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
66275 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
66276 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
66277 return __ret;
66278}
65864#define vqrdmlsh_laneq_s32(__p0_816, __p1_816, __p2_816, __p3_816) __extension__ ({ \
65865 int32x2_t __ret_816; \
65866 int32x2_t __s0_816 = __p0_816; \
65867 int32x2_t __s1_816 = __p1_816; \
65868 int32x4_t __s2_816 = __p2_816; \
65869 int32x2_t __rev0_816; __rev0_816 = __builtin_shufflevector(__s0_816, __s0_816, 1, 0); \
65870 int32x2_t __rev1_816; __rev1_816 = __builtin_shufflevector(__s1_816, __s1_816, 1, 0); \
65871 int32x4_t __rev2_816; __rev2_816 = __builtin_shufflevector(__s2_816, __s2_816, 3, 2, 1, 0); \
65872 __ret_816 = __noswap_vqrdmlsh_s32(__rev0_816, __rev1_816, __noswap_splat_laneq_s32(__rev2_816, __p3_816)); \
65873 __ret_816 = __builtin_shufflevector(__ret_816, __ret_816, 1, 0); \
65874 __ret_816; \
65875})
6627965876#endif
6628065877
6628165878#ifdef __LITTLE_ENDIAN__
66282__ai uint16x8_t vzip1q_u16(uint16x8_t __p0, uint16x8_t __p1) {
66283 uint16x8_t __ret;
66284 __ret = __builtin_shufflevector(__p0, __p1, 0, 8, 1, 9, 2, 10, 3, 11);
66285 return __ret;
66286}
65879#define vqrdmlsh_laneq_s16(__p0_817, __p1_817, __p2_817, __p3_817) __extension__ ({ \
65880 int16x4_t __ret_817; \
65881 int16x4_t __s0_817 = __p0_817; \
65882 int16x4_t __s1_817 = __p1_817; \
65883 int16x8_t __s2_817 = __p2_817; \
65884 __ret_817 = vqrdmlsh_s16(__s0_817, __s1_817, splat_laneq_s16(__s2_817, __p3_817)); \
65885 __ret_817; \
65886})
6628765887#else
66288__ai uint16x8_t vzip1q_u16(uint16x8_t __p0, uint16x8_t __p1) {
66289 uint16x8_t __ret;
66290 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
66291 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
66292 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 8, 1, 9, 2, 10, 3, 11);
66293 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
66294 return __ret;
66295}
65888#define vqrdmlsh_laneq_s16(__p0_818, __p1_818, __p2_818, __p3_818) __extension__ ({ \
65889 int16x4_t __ret_818; \
65890 int16x4_t __s0_818 = __p0_818; \
65891 int16x4_t __s1_818 = __p1_818; \
65892 int16x8_t __s2_818 = __p2_818; \
65893 int16x4_t __rev0_818; __rev0_818 = __builtin_shufflevector(__s0_818, __s0_818, 3, 2, 1, 0); \
65894 int16x4_t __rev1_818; __rev1_818 = __builtin_shufflevector(__s1_818, __s1_818, 3, 2, 1, 0); \
65895 int16x8_t __rev2_818; __rev2_818 = __builtin_shufflevector(__s2_818, __s2_818, 7, 6, 5, 4, 3, 2, 1, 0); \
65896 __ret_818 = __noswap_vqrdmlsh_s16(__rev0_818, __rev1_818, __noswap_splat_laneq_s16(__rev2_818, __p3_818)); \
65897 __ret_818 = __builtin_shufflevector(__ret_818, __ret_818, 3, 2, 1, 0); \
65898 __ret_818; \
65899})
6629665900#endif
6629765901
6629865902#ifdef __LITTLE_ENDIAN__
66299__ai int8x16_t vzip1q_s8(int8x16_t __p0, int8x16_t __p1) {
66300 int8x16_t __ret;
66301 __ret = __builtin_shufflevector(__p0, __p1, 0, 16, 1, 17, 2, 18, 3, 19, 4, 20, 5, 21, 6, 22, 7, 23);
65903__ai __attribute__((target("v8.3a"))) float64x2_t vcaddq_rot270_f64(float64x2_t __p0, float64x2_t __p1) {
65904 float64x2_t __ret;
65905 __ret = (float64x2_t) __builtin_neon_vcaddq_rot270_f64((int8x16_t)__p0, (int8x16_t)__p1, 42);
6630265906 return __ret;
6630365907}
6630465908#else
66305__ai int8x16_t vzip1q_s8(int8x16_t __p0, int8x16_t __p1) {
66306 int8x16_t __ret;
66307 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
66308 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
66309 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 16, 1, 17, 2, 18, 3, 19, 4, 20, 5, 21, 6, 22, 7, 23);
66310 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
65909__ai __attribute__((target("v8.3a"))) float64x2_t vcaddq_rot270_f64(float64x2_t __p0, float64x2_t __p1) {
65910 float64x2_t __ret;
65911 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
65912 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
65913 __ret = (float64x2_t) __builtin_neon_vcaddq_rot270_f64((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
65914 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6631165915 return __ret;
6631265916}
6631365917#endif
6631465918
6631565919#ifdef __LITTLE_ENDIAN__
66316__ai float64x2_t vzip1q_f64(float64x2_t __p0, float64x2_t __p1) {
65920__ai __attribute__((target("v8.3a"))) float64x2_t vcaddq_rot90_f64(float64x2_t __p0, float64x2_t __p1) {
6631765921 float64x2_t __ret;
66318 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
65922 __ret = (float64x2_t) __builtin_neon_vcaddq_rot90_f64((int8x16_t)__p0, (int8x16_t)__p1, 42);
6631965923 return __ret;
6632065924}
6632165925#else
66322__ai float64x2_t vzip1q_f64(float64x2_t __p0, float64x2_t __p1) {
65926__ai __attribute__((target("v8.3a"))) float64x2_t vcaddq_rot90_f64(float64x2_t __p0, float64x2_t __p1) {
6632365927 float64x2_t __ret;
6632465928 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
6632565929 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
66326 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
65930 __ret = (float64x2_t) __builtin_neon_vcaddq_rot90_f64((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
6632765931 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6632865932 return __ret;
6632965933}
6633065934#endif
6633165935
6633265936#ifdef __LITTLE_ENDIAN__
66333__ai float32x4_t vzip1q_f32(float32x4_t __p0, float32x4_t __p1) {
66334 float32x4_t __ret;
66335 __ret = __builtin_shufflevector(__p0, __p1, 0, 4, 1, 5);
65937__ai __attribute__((target("v8.3a"))) float64x2_t vcmlaq_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
65938 float64x2_t __ret;
65939 __ret = (float64x2_t) __builtin_neon_vcmlaq_f64((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 42);
6633665940 return __ret;
6633765941}
6633865942#else
66339__ai float32x4_t vzip1q_f32(float32x4_t __p0, float32x4_t __p1) {
66340 float32x4_t __ret;
66341 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
66342 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
66343 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 4, 1, 5);
66344 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
65943__ai __attribute__((target("v8.3a"))) float64x2_t vcmlaq_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
65944 float64x2_t __ret;
65945 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
65946 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
65947 float64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
65948 __ret = (float64x2_t) __builtin_neon_vcmlaq_f64((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 42);
65949 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
65950 return __ret;
65951}
65952__ai __attribute__((target("v8.3a"))) float64x2_t __noswap_vcmlaq_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
65953 float64x2_t __ret;
65954 __ret = (float64x2_t) __builtin_neon_vcmlaq_f64((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 42);
6634565955 return __ret;
6634665956}
6634765957#endif
6634865958
66349#ifdef __LITTLE_ENDIAN__
66350__ai int32x4_t vzip1q_s32(int32x4_t __p0, int32x4_t __p1) {
66351 int32x4_t __ret;
66352 __ret = __builtin_shufflevector(__p0, __p1, 0, 4, 1, 5);
65959__ai __attribute__((target("v8.3a"))) float64x1_t vcmla_f64(float64x1_t __p0, float64x1_t __p1, float64x1_t __p2) {
65960 float64x1_t __ret;
65961 __ret = (float64x1_t) __builtin_neon_vcmla_f64((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 10);
6635365962 return __ret;
6635465963}
65964#define vcmla_lane_f64(__p0_819, __p1_819, __p2_819, __p3_819) __extension__ ({ \
65965 float64x1_t __ret_819; \
65966 float64x1_t __s0_819 = __p0_819; \
65967 float64x1_t __s1_819 = __p1_819; \
65968 float64x1_t __s2_819 = __p2_819; \
65969float64x1_t __reint_819 = __s2_819; \
65970uint64x2_t __reint1_819 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_819, __p3_819), vgetq_lane_u64(*(uint64x2_t *) &__reint_819, __p3_819)}; \
65971 __ret_819 = vcmla_f64(__s0_819, __s1_819, *(float64x1_t *) &__reint1_819); \
65972 __ret_819; \
65973})
65974#ifdef __LITTLE_ENDIAN__
65975#define vcmlaq_lane_f64(__p0_820, __p1_820, __p2_820, __p3_820) __extension__ ({ \
65976 float64x2_t __ret_820; \
65977 float64x2_t __s0_820 = __p0_820; \
65978 float64x2_t __s1_820 = __p1_820; \
65979 float64x1_t __s2_820 = __p2_820; \
65980float64x1_t __reint_820 = __s2_820; \
65981uint64x2_t __reint1_820 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_820, __p3_820), vgetq_lane_u64(*(uint64x2_t *) &__reint_820, __p3_820)}; \
65982 __ret_820 = vcmlaq_f64(__s0_820, __s1_820, *(float64x2_t *) &__reint1_820); \
65983 __ret_820; \
65984})
6635565985#else
66356__ai int32x4_t vzip1q_s32(int32x4_t __p0, int32x4_t __p1) {
66357 int32x4_t __ret;
66358 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
66359 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
66360 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 4, 1, 5);
66361 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
66362 return __ret;
66363}
65986#define vcmlaq_lane_f64(__p0_821, __p1_821, __p2_821, __p3_821) __extension__ ({ \
65987 float64x2_t __ret_821; \
65988 float64x2_t __s0_821 = __p0_821; \
65989 float64x2_t __s1_821 = __p1_821; \
65990 float64x1_t __s2_821 = __p2_821; \
65991 float64x2_t __rev0_821; __rev0_821 = __builtin_shufflevector(__s0_821, __s0_821, 1, 0); \
65992 float64x2_t __rev1_821; __rev1_821 = __builtin_shufflevector(__s1_821, __s1_821, 1, 0); \
65993float64x1_t __reint_821 = __s2_821; \
65994uint64x2_t __reint1_821 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_821, __p3_821), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_821, __p3_821)}; \
65995 __ret_821 = __noswap_vcmlaq_f64(__rev0_821, __rev1_821, *(float64x2_t *) &__reint1_821); \
65996 __ret_821 = __builtin_shufflevector(__ret_821, __ret_821, 1, 0); \
65997 __ret_821; \
65998})
6636465999#endif
6636566000
6636666001#ifdef __LITTLE_ENDIAN__
66367__ai int64x2_t vzip1q_s64(int64x2_t __p0, int64x2_t __p1) {
66368 int64x2_t __ret;
66369 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
66370 return __ret;
66371}
66002#define vcmla_laneq_f64(__p0_822, __p1_822, __p2_822, __p3_822) __extension__ ({ \
66003 float64x1_t __ret_822; \
66004 float64x1_t __s0_822 = __p0_822; \
66005 float64x1_t __s1_822 = __p1_822; \
66006 float64x2_t __s2_822 = __p2_822; \
66007float64x2_t __reint_822 = __s2_822; \
66008uint64x2_t __reint1_822 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_822, __p3_822), vgetq_lane_u64(*(uint64x2_t *) &__reint_822, __p3_822)}; \
66009 __ret_822 = vcmla_f64(__s0_822, __s1_822, *(float64x1_t *) &__reint1_822); \
66010 __ret_822; \
66011})
6637266012#else
66373__ai int64x2_t vzip1q_s64(int64x2_t __p0, int64x2_t __p1) {
66374 int64x2_t __ret;
66375 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66376 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
66377 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
66378 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
66379 return __ret;
66380}
66013#define vcmla_laneq_f64(__p0_823, __p1_823, __p2_823, __p3_823) __extension__ ({ \
66014 float64x1_t __ret_823; \
66015 float64x1_t __s0_823 = __p0_823; \
66016 float64x1_t __s1_823 = __p1_823; \
66017 float64x2_t __s2_823 = __p2_823; \
66018 float64x2_t __rev2_823; __rev2_823 = __builtin_shufflevector(__s2_823, __s2_823, 1, 0); \
66019float64x2_t __reint_823 = __rev2_823; \
66020uint64x2_t __reint1_823 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_823, __p3_823), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_823, __p3_823)}; \
66021 __ret_823 = vcmla_f64(__s0_823, __s1_823, *(float64x1_t *) &__reint1_823); \
66022 __ret_823; \
66023})
6638166024#endif
6638266025
6638366026#ifdef __LITTLE_ENDIAN__
66384__ai int16x8_t vzip1q_s16(int16x8_t __p0, int16x8_t __p1) {
66385 int16x8_t __ret;
66386 __ret = __builtin_shufflevector(__p0, __p1, 0, 8, 1, 9, 2, 10, 3, 11);
66387 return __ret;
66388}
66027#define vcmlaq_laneq_f64(__p0_824, __p1_824, __p2_824, __p3_824) __extension__ ({ \
66028 float64x2_t __ret_824; \
66029 float64x2_t __s0_824 = __p0_824; \
66030 float64x2_t __s1_824 = __p1_824; \
66031 float64x2_t __s2_824 = __p2_824; \
66032float64x2_t __reint_824 = __s2_824; \
66033uint64x2_t __reint1_824 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_824, __p3_824), vgetq_lane_u64(*(uint64x2_t *) &__reint_824, __p3_824)}; \
66034 __ret_824 = vcmlaq_f64(__s0_824, __s1_824, *(float64x2_t *) &__reint1_824); \
66035 __ret_824; \
66036})
6638966037#else
66390__ai int16x8_t vzip1q_s16(int16x8_t __p0, int16x8_t __p1) {
66391 int16x8_t __ret;
66392 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
66393 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
66394 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 8, 1, 9, 2, 10, 3, 11);
66395 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
66396 return __ret;
66397}
66038#define vcmlaq_laneq_f64(__p0_825, __p1_825, __p2_825, __p3_825) __extension__ ({ \
66039 float64x2_t __ret_825; \
66040 float64x2_t __s0_825 = __p0_825; \
66041 float64x2_t __s1_825 = __p1_825; \
66042 float64x2_t __s2_825 = __p2_825; \
66043 float64x2_t __rev0_825; __rev0_825 = __builtin_shufflevector(__s0_825, __s0_825, 1, 0); \
66044 float64x2_t __rev1_825; __rev1_825 = __builtin_shufflevector(__s1_825, __s1_825, 1, 0); \
66045 float64x2_t __rev2_825; __rev2_825 = __builtin_shufflevector(__s2_825, __s2_825, 1, 0); \
66046float64x2_t __reint_825 = __rev2_825; \
66047uint64x2_t __reint1_825 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_825, __p3_825), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_825, __p3_825)}; \
66048 __ret_825 = __noswap_vcmlaq_f64(__rev0_825, __rev1_825, *(float64x2_t *) &__reint1_825); \
66049 __ret_825 = __builtin_shufflevector(__ret_825, __ret_825, 1, 0); \
66050 __ret_825; \
66051})
6639866052#endif
6639966053
6640066054#ifdef __LITTLE_ENDIAN__
66401__ai uint8x8_t vzip1_u8(uint8x8_t __p0, uint8x8_t __p1) {
66402 uint8x8_t __ret;
66403 __ret = __builtin_shufflevector(__p0, __p1, 0, 8, 1, 9, 2, 10, 3, 11);
66055__ai __attribute__((target("v8.3a"))) float64x2_t vcmlaq_rot180_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
66056 float64x2_t __ret;
66057 __ret = (float64x2_t) __builtin_neon_vcmlaq_rot180_f64((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 42);
6640466058 return __ret;
6640566059}
6640666060#else
66407__ai uint8x8_t vzip1_u8(uint8x8_t __p0, uint8x8_t __p1) {
66408 uint8x8_t __ret;
66409 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
66410 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
66411 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 8, 1, 9, 2, 10, 3, 11);
66412 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
66061__ai __attribute__((target("v8.3a"))) float64x2_t vcmlaq_rot180_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
66062 float64x2_t __ret;
66063 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66064 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
66065 float64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
66066 __ret = (float64x2_t) __builtin_neon_vcmlaq_rot180_f64((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 42);
66067 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
66068 return __ret;
66069}
66070__ai __attribute__((target("v8.3a"))) float64x2_t __noswap_vcmlaq_rot180_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
66071 float64x2_t __ret;
66072 __ret = (float64x2_t) __builtin_neon_vcmlaq_rot180_f64((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 42);
6641366073 return __ret;
6641466074}
6641566075#endif
6641666076
66417#ifdef __LITTLE_ENDIAN__
66418__ai uint32x2_t vzip1_u32(uint32x2_t __p0, uint32x2_t __p1) {
66419 uint32x2_t __ret;
66420 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
66077__ai __attribute__((target("v8.3a"))) float64x1_t vcmla_rot180_f64(float64x1_t __p0, float64x1_t __p1, float64x1_t __p2) {
66078 float64x1_t __ret;
66079 __ret = (float64x1_t) __builtin_neon_vcmla_rot180_f64((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 10);
6642166080 return __ret;
6642266081}
66082#define vcmla_rot180_lane_f64(__p0_826, __p1_826, __p2_826, __p3_826) __extension__ ({ \
66083 float64x1_t __ret_826; \
66084 float64x1_t __s0_826 = __p0_826; \
66085 float64x1_t __s1_826 = __p1_826; \
66086 float64x1_t __s2_826 = __p2_826; \
66087float64x1_t __reint_826 = __s2_826; \
66088uint64x2_t __reint1_826 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_826, __p3_826), vgetq_lane_u64(*(uint64x2_t *) &__reint_826, __p3_826)}; \
66089 __ret_826 = vcmla_rot180_f64(__s0_826, __s1_826, *(float64x1_t *) &__reint1_826); \
66090 __ret_826; \
66091})
66092#ifdef __LITTLE_ENDIAN__
66093#define vcmlaq_rot180_lane_f64(__p0_827, __p1_827, __p2_827, __p3_827) __extension__ ({ \
66094 float64x2_t __ret_827; \
66095 float64x2_t __s0_827 = __p0_827; \
66096 float64x2_t __s1_827 = __p1_827; \
66097 float64x1_t __s2_827 = __p2_827; \
66098float64x1_t __reint_827 = __s2_827; \
66099uint64x2_t __reint1_827 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_827, __p3_827), vgetq_lane_u64(*(uint64x2_t *) &__reint_827, __p3_827)}; \
66100 __ret_827 = vcmlaq_rot180_f64(__s0_827, __s1_827, *(float64x2_t *) &__reint1_827); \
66101 __ret_827; \
66102})
6642366103#else
66424__ai uint32x2_t vzip1_u32(uint32x2_t __p0, uint32x2_t __p1) {
66425 uint32x2_t __ret;
66426 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66427 uint32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
66428 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
66429 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
66430 return __ret;
66431}
66104#define vcmlaq_rot180_lane_f64(__p0_828, __p1_828, __p2_828, __p3_828) __extension__ ({ \
66105 float64x2_t __ret_828; \
66106 float64x2_t __s0_828 = __p0_828; \
66107 float64x2_t __s1_828 = __p1_828; \
66108 float64x1_t __s2_828 = __p2_828; \
66109 float64x2_t __rev0_828; __rev0_828 = __builtin_shufflevector(__s0_828, __s0_828, 1, 0); \
66110 float64x2_t __rev1_828; __rev1_828 = __builtin_shufflevector(__s1_828, __s1_828, 1, 0); \
66111float64x1_t __reint_828 = __s2_828; \
66112uint64x2_t __reint1_828 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_828, __p3_828), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_828, __p3_828)}; \
66113 __ret_828 = __noswap_vcmlaq_rot180_f64(__rev0_828, __rev1_828, *(float64x2_t *) &__reint1_828); \
66114 __ret_828 = __builtin_shufflevector(__ret_828, __ret_828, 1, 0); \
66115 __ret_828; \
66116})
6643266117#endif
6643366118
6643466119#ifdef __LITTLE_ENDIAN__
66435__ai uint16x4_t vzip1_u16(uint16x4_t __p0, uint16x4_t __p1) {
66436 uint16x4_t __ret;
66437 __ret = __builtin_shufflevector(__p0, __p1, 0, 4, 1, 5);
66438 return __ret;
66439}
66120#define vcmla_rot180_laneq_f64(__p0_829, __p1_829, __p2_829, __p3_829) __extension__ ({ \
66121 float64x1_t __ret_829; \
66122 float64x1_t __s0_829 = __p0_829; \
66123 float64x1_t __s1_829 = __p1_829; \
66124 float64x2_t __s2_829 = __p2_829; \
66125float64x2_t __reint_829 = __s2_829; \
66126uint64x2_t __reint1_829 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_829, __p3_829), vgetq_lane_u64(*(uint64x2_t *) &__reint_829, __p3_829)}; \
66127 __ret_829 = vcmla_rot180_f64(__s0_829, __s1_829, *(float64x1_t *) &__reint1_829); \
66128 __ret_829; \
66129})
6644066130#else
66441__ai uint16x4_t vzip1_u16(uint16x4_t __p0, uint16x4_t __p1) {
66442 uint16x4_t __ret;
66443 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
66444 uint16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
66445 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 4, 1, 5);
66446 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
66447 return __ret;
66448}
66131#define vcmla_rot180_laneq_f64(__p0_830, __p1_830, __p2_830, __p3_830) __extension__ ({ \
66132 float64x1_t __ret_830; \
66133 float64x1_t __s0_830 = __p0_830; \
66134 float64x1_t __s1_830 = __p1_830; \
66135 float64x2_t __s2_830 = __p2_830; \
66136 float64x2_t __rev2_830; __rev2_830 = __builtin_shufflevector(__s2_830, __s2_830, 1, 0); \
66137float64x2_t __reint_830 = __rev2_830; \
66138uint64x2_t __reint1_830 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_830, __p3_830), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_830, __p3_830)}; \
66139 __ret_830 = vcmla_rot180_f64(__s0_830, __s1_830, *(float64x1_t *) &__reint1_830); \
66140 __ret_830; \
66141})
6644966142#endif
6645066143
6645166144#ifdef __LITTLE_ENDIAN__
66452__ai int8x8_t vzip1_s8(int8x8_t __p0, int8x8_t __p1) {
66453 int8x8_t __ret;
66454 __ret = __builtin_shufflevector(__p0, __p1, 0, 8, 1, 9, 2, 10, 3, 11);
66455 return __ret;
66456}
66145#define vcmlaq_rot180_laneq_f64(__p0_831, __p1_831, __p2_831, __p3_831) __extension__ ({ \
66146 float64x2_t __ret_831; \
66147 float64x2_t __s0_831 = __p0_831; \
66148 float64x2_t __s1_831 = __p1_831; \
66149 float64x2_t __s2_831 = __p2_831; \
66150float64x2_t __reint_831 = __s2_831; \
66151uint64x2_t __reint1_831 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_831, __p3_831), vgetq_lane_u64(*(uint64x2_t *) &__reint_831, __p3_831)}; \
66152 __ret_831 = vcmlaq_rot180_f64(__s0_831, __s1_831, *(float64x2_t *) &__reint1_831); \
66153 __ret_831; \
66154})
6645766155#else
66458__ai int8x8_t vzip1_s8(int8x8_t __p0, int8x8_t __p1) {
66459 int8x8_t __ret;
66460 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
66461 int8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
66462 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 8, 1, 9, 2, 10, 3, 11);
66463 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
66464 return __ret;
66465}
66156#define vcmlaq_rot180_laneq_f64(__p0_832, __p1_832, __p2_832, __p3_832) __extension__ ({ \
66157 float64x2_t __ret_832; \
66158 float64x2_t __s0_832 = __p0_832; \
66159 float64x2_t __s1_832 = __p1_832; \
66160 float64x2_t __s2_832 = __p2_832; \
66161 float64x2_t __rev0_832; __rev0_832 = __builtin_shufflevector(__s0_832, __s0_832, 1, 0); \
66162 float64x2_t __rev1_832; __rev1_832 = __builtin_shufflevector(__s1_832, __s1_832, 1, 0); \
66163 float64x2_t __rev2_832; __rev2_832 = __builtin_shufflevector(__s2_832, __s2_832, 1, 0); \
66164float64x2_t __reint_832 = __rev2_832; \
66165uint64x2_t __reint1_832 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_832, __p3_832), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_832, __p3_832)}; \
66166 __ret_832 = __noswap_vcmlaq_rot180_f64(__rev0_832, __rev1_832, *(float64x2_t *) &__reint1_832); \
66167 __ret_832 = __builtin_shufflevector(__ret_832, __ret_832, 1, 0); \
66168 __ret_832; \
66169})
6646666170#endif
6646766171
6646866172#ifdef __LITTLE_ENDIAN__
66469__ai float32x2_t vzip1_f32(float32x2_t __p0, float32x2_t __p1) {
66470 float32x2_t __ret;
66471 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
66173__ai __attribute__((target("v8.3a"))) float64x2_t vcmlaq_rot270_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
66174 float64x2_t __ret;
66175 __ret = (float64x2_t) __builtin_neon_vcmlaq_rot270_f64((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 42);
6647266176 return __ret;
6647366177}
6647466178#else
66475__ai float32x2_t vzip1_f32(float32x2_t __p0, float32x2_t __p1) {
66476 float32x2_t __ret;
66477 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66478 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
66479 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
66179__ai __attribute__((target("v8.3a"))) float64x2_t vcmlaq_rot270_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
66180 float64x2_t __ret;
66181 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66182 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
66183 float64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
66184 __ret = (float64x2_t) __builtin_neon_vcmlaq_rot270_f64((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 42);
6648066185 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6648166186 return __ret;
6648266187}
66188__ai __attribute__((target("v8.3a"))) float64x2_t __noswap_vcmlaq_rot270_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
66189 float64x2_t __ret;
66190 __ret = (float64x2_t) __builtin_neon_vcmlaq_rot270_f64((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 42);
66191 return __ret;
66192}
6648366193#endif
6648466194
66485#ifdef __LITTLE_ENDIAN__
66486__ai int32x2_t vzip1_s32(int32x2_t __p0, int32x2_t __p1) {
66487 int32x2_t __ret;
66488 __ret = __builtin_shufflevector(__p0, __p1, 0, 2);
66195__ai __attribute__((target("v8.3a"))) float64x1_t vcmla_rot270_f64(float64x1_t __p0, float64x1_t __p1, float64x1_t __p2) {
66196 float64x1_t __ret;
66197 __ret = (float64x1_t) __builtin_neon_vcmla_rot270_f64((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 10);
6648966198 return __ret;
6649066199}
66200#define vcmla_rot270_lane_f64(__p0_833, __p1_833, __p2_833, __p3_833) __extension__ ({ \
66201 float64x1_t __ret_833; \
66202 float64x1_t __s0_833 = __p0_833; \
66203 float64x1_t __s1_833 = __p1_833; \
66204 float64x1_t __s2_833 = __p2_833; \
66205float64x1_t __reint_833 = __s2_833; \
66206uint64x2_t __reint1_833 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_833, __p3_833), vgetq_lane_u64(*(uint64x2_t *) &__reint_833, __p3_833)}; \
66207 __ret_833 = vcmla_rot270_f64(__s0_833, __s1_833, *(float64x1_t *) &__reint1_833); \
66208 __ret_833; \
66209})
66210#ifdef __LITTLE_ENDIAN__
66211#define vcmlaq_rot270_lane_f64(__p0_834, __p1_834, __p2_834, __p3_834) __extension__ ({ \
66212 float64x2_t __ret_834; \
66213 float64x2_t __s0_834 = __p0_834; \
66214 float64x2_t __s1_834 = __p1_834; \
66215 float64x1_t __s2_834 = __p2_834; \
66216float64x1_t __reint_834 = __s2_834; \
66217uint64x2_t __reint1_834 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_834, __p3_834), vgetq_lane_u64(*(uint64x2_t *) &__reint_834, __p3_834)}; \
66218 __ret_834 = vcmlaq_rot270_f64(__s0_834, __s1_834, *(float64x2_t *) &__reint1_834); \
66219 __ret_834; \
66220})
6649166221#else
66492__ai int32x2_t vzip1_s32(int32x2_t __p0, int32x2_t __p1) {
66493 int32x2_t __ret;
66494 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66495 int32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
66496 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 2);
66497 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
66498 return __ret;
66499}
66222#define vcmlaq_rot270_lane_f64(__p0_835, __p1_835, __p2_835, __p3_835) __extension__ ({ \
66223 float64x2_t __ret_835; \
66224 float64x2_t __s0_835 = __p0_835; \
66225 float64x2_t __s1_835 = __p1_835; \
66226 float64x1_t __s2_835 = __p2_835; \
66227 float64x2_t __rev0_835; __rev0_835 = __builtin_shufflevector(__s0_835, __s0_835, 1, 0); \
66228 float64x2_t __rev1_835; __rev1_835 = __builtin_shufflevector(__s1_835, __s1_835, 1, 0); \
66229float64x1_t __reint_835 = __s2_835; \
66230uint64x2_t __reint1_835 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_835, __p3_835), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_835, __p3_835)}; \
66231 __ret_835 = __noswap_vcmlaq_rot270_f64(__rev0_835, __rev1_835, *(float64x2_t *) &__reint1_835); \
66232 __ret_835 = __builtin_shufflevector(__ret_835, __ret_835, 1, 0); \
66233 __ret_835; \
66234})
6650066235#endif
6650166236
6650266237#ifdef __LITTLE_ENDIAN__
66503__ai int16x4_t vzip1_s16(int16x4_t __p0, int16x4_t __p1) {
66504 int16x4_t __ret;
66505 __ret = __builtin_shufflevector(__p0, __p1, 0, 4, 1, 5);
66506 return __ret;
66507}
66238#define vcmla_rot270_laneq_f64(__p0_836, __p1_836, __p2_836, __p3_836) __extension__ ({ \
66239 float64x1_t __ret_836; \
66240 float64x1_t __s0_836 = __p0_836; \
66241 float64x1_t __s1_836 = __p1_836; \
66242 float64x2_t __s2_836 = __p2_836; \
66243float64x2_t __reint_836 = __s2_836; \
66244uint64x2_t __reint1_836 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_836, __p3_836), vgetq_lane_u64(*(uint64x2_t *) &__reint_836, __p3_836)}; \
66245 __ret_836 = vcmla_rot270_f64(__s0_836, __s1_836, *(float64x1_t *) &__reint1_836); \
66246 __ret_836; \
66247})
6650866248#else
66509__ai int16x4_t vzip1_s16(int16x4_t __p0, int16x4_t __p1) {
66510 int16x4_t __ret;
66511 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
66512 int16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
66513 __ret = __builtin_shufflevector(__rev0, __rev1, 0, 4, 1, 5);
66514 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
66515 return __ret;
66516}
66249#define vcmla_rot270_laneq_f64(__p0_837, __p1_837, __p2_837, __p3_837) __extension__ ({ \
66250 float64x1_t __ret_837; \
66251 float64x1_t __s0_837 = __p0_837; \
66252 float64x1_t __s1_837 = __p1_837; \
66253 float64x2_t __s2_837 = __p2_837; \
66254 float64x2_t __rev2_837; __rev2_837 = __builtin_shufflevector(__s2_837, __s2_837, 1, 0); \
66255float64x2_t __reint_837 = __rev2_837; \
66256uint64x2_t __reint1_837 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_837, __p3_837), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_837, __p3_837)}; \
66257 __ret_837 = vcmla_rot270_f64(__s0_837, __s1_837, *(float64x1_t *) &__reint1_837); \
66258 __ret_837; \
66259})
6651766260#endif
6651866261
6651966262#ifdef __LITTLE_ENDIAN__
66520__ai poly8x8_t vzip2_p8(poly8x8_t __p0, poly8x8_t __p1) {
66521 poly8x8_t __ret;
66522 __ret = __builtin_shufflevector(__p0, __p1, 4, 12, 5, 13, 6, 14, 7, 15);
66523 return __ret;
66524}
66263#define vcmlaq_rot270_laneq_f64(__p0_838, __p1_838, __p2_838, __p3_838) __extension__ ({ \
66264 float64x2_t __ret_838; \
66265 float64x2_t __s0_838 = __p0_838; \
66266 float64x2_t __s1_838 = __p1_838; \
66267 float64x2_t __s2_838 = __p2_838; \
66268float64x2_t __reint_838 = __s2_838; \
66269uint64x2_t __reint1_838 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_838, __p3_838), vgetq_lane_u64(*(uint64x2_t *) &__reint_838, __p3_838)}; \
66270 __ret_838 = vcmlaq_rot270_f64(__s0_838, __s1_838, *(float64x2_t *) &__reint1_838); \
66271 __ret_838; \
66272})
6652566273#else
66526__ai poly8x8_t vzip2_p8(poly8x8_t __p0, poly8x8_t __p1) {
66527 poly8x8_t __ret;
66528 poly8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
66529 poly8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
66530 __ret = __builtin_shufflevector(__rev0, __rev1, 4, 12, 5, 13, 6, 14, 7, 15);
66531 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
66532 return __ret;
66533}
66274#define vcmlaq_rot270_laneq_f64(__p0_839, __p1_839, __p2_839, __p3_839) __extension__ ({ \
66275 float64x2_t __ret_839; \
66276 float64x2_t __s0_839 = __p0_839; \
66277 float64x2_t __s1_839 = __p1_839; \
66278 float64x2_t __s2_839 = __p2_839; \
66279 float64x2_t __rev0_839; __rev0_839 = __builtin_shufflevector(__s0_839, __s0_839, 1, 0); \
66280 float64x2_t __rev1_839; __rev1_839 = __builtin_shufflevector(__s1_839, __s1_839, 1, 0); \
66281 float64x2_t __rev2_839; __rev2_839 = __builtin_shufflevector(__s2_839, __s2_839, 1, 0); \
66282float64x2_t __reint_839 = __rev2_839; \
66283uint64x2_t __reint1_839 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_839, __p3_839), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_839, __p3_839)}; \
66284 __ret_839 = __noswap_vcmlaq_rot270_f64(__rev0_839, __rev1_839, *(float64x2_t *) &__reint1_839); \
66285 __ret_839 = __builtin_shufflevector(__ret_839, __ret_839, 1, 0); \
66286 __ret_839; \
66287})
6653466288#endif
6653566289
6653666290#ifdef __LITTLE_ENDIAN__
66537__ai poly16x4_t vzip2_p16(poly16x4_t __p0, poly16x4_t __p1) {
66538 poly16x4_t __ret;
66539 __ret = __builtin_shufflevector(__p0, __p1, 2, 6, 3, 7);
66291__ai __attribute__((target("v8.3a"))) float64x2_t vcmlaq_rot90_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
66292 float64x2_t __ret;
66293 __ret = (float64x2_t) __builtin_neon_vcmlaq_rot90_f64((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 42);
6654066294 return __ret;
6654166295}
6654266296#else
66543__ai poly16x4_t vzip2_p16(poly16x4_t __p0, poly16x4_t __p1) {
66544 poly16x4_t __ret;
66545 poly16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
66546 poly16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
66547 __ret = __builtin_shufflevector(__rev0, __rev1, 2, 6, 3, 7);
66548 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
66297__ai __attribute__((target("v8.3a"))) float64x2_t vcmlaq_rot90_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
66298 float64x2_t __ret;
66299 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66300 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
66301 float64x2_t __rev2; __rev2 = __builtin_shufflevector(__p2, __p2, 1, 0);
66302 __ret = (float64x2_t) __builtin_neon_vcmlaq_rot90_f64((int8x16_t)__rev0, (int8x16_t)__rev1, (int8x16_t)__rev2, 42);
66303 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
66304 return __ret;
66305}
66306__ai __attribute__((target("v8.3a"))) float64x2_t __noswap_vcmlaq_rot90_f64(float64x2_t __p0, float64x2_t __p1, float64x2_t __p2) {
66307 float64x2_t __ret;
66308 __ret = (float64x2_t) __builtin_neon_vcmlaq_rot90_f64((int8x16_t)__p0, (int8x16_t)__p1, (int8x16_t)__p2, 42);
6654966309 return __ret;
6655066310}
6655166311#endif
6655266312
66553#ifdef __LITTLE_ENDIAN__
66554__ai poly8x16_t vzip2q_p8(poly8x16_t __p0, poly8x16_t __p1) {
66555 poly8x16_t __ret;
66556 __ret = __builtin_shufflevector(__p0, __p1, 8, 24, 9, 25, 10, 26, 11, 27, 12, 28, 13, 29, 14, 30, 15, 31);
66313__ai __attribute__((target("v8.3a"))) float64x1_t vcmla_rot90_f64(float64x1_t __p0, float64x1_t __p1, float64x1_t __p2) {
66314 float64x1_t __ret;
66315 __ret = (float64x1_t) __builtin_neon_vcmla_rot90_f64((int8x8_t)__p0, (int8x8_t)__p1, (int8x8_t)__p2, 10);
6655766316 return __ret;
6655866317}
66318#define vcmla_rot90_lane_f64(__p0_840, __p1_840, __p2_840, __p3_840) __extension__ ({ \
66319 float64x1_t __ret_840; \
66320 float64x1_t __s0_840 = __p0_840; \
66321 float64x1_t __s1_840 = __p1_840; \
66322 float64x1_t __s2_840 = __p2_840; \
66323float64x1_t __reint_840 = __s2_840; \
66324uint64x2_t __reint1_840 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_840, __p3_840), vgetq_lane_u64(*(uint64x2_t *) &__reint_840, __p3_840)}; \
66325 __ret_840 = vcmla_rot90_f64(__s0_840, __s1_840, *(float64x1_t *) &__reint1_840); \
66326 __ret_840; \
66327})
66328#ifdef __LITTLE_ENDIAN__
66329#define vcmlaq_rot90_lane_f64(__p0_841, __p1_841, __p2_841, __p3_841) __extension__ ({ \
66330 float64x2_t __ret_841; \
66331 float64x2_t __s0_841 = __p0_841; \
66332 float64x2_t __s1_841 = __p1_841; \
66333 float64x1_t __s2_841 = __p2_841; \
66334float64x1_t __reint_841 = __s2_841; \
66335uint64x2_t __reint1_841 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_841, __p3_841), vgetq_lane_u64(*(uint64x2_t *) &__reint_841, __p3_841)}; \
66336 __ret_841 = vcmlaq_rot90_f64(__s0_841, __s1_841, *(float64x2_t *) &__reint1_841); \
66337 __ret_841; \
66338})
6655966339#else
66560__ai poly8x16_t vzip2q_p8(poly8x16_t __p0, poly8x16_t __p1) {
66561 poly8x16_t __ret;
66562 poly8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
66563 poly8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
66564 __ret = __builtin_shufflevector(__rev0, __rev1, 8, 24, 9, 25, 10, 26, 11, 27, 12, 28, 13, 29, 14, 30, 15, 31);
66565 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
66566 return __ret;
66567}
66340#define vcmlaq_rot90_lane_f64(__p0_842, __p1_842, __p2_842, __p3_842) __extension__ ({ \
66341 float64x2_t __ret_842; \
66342 float64x2_t __s0_842 = __p0_842; \
66343 float64x2_t __s1_842 = __p1_842; \
66344 float64x1_t __s2_842 = __p2_842; \
66345 float64x2_t __rev0_842; __rev0_842 = __builtin_shufflevector(__s0_842, __s0_842, 1, 0); \
66346 float64x2_t __rev1_842; __rev1_842 = __builtin_shufflevector(__s1_842, __s1_842, 1, 0); \
66347float64x1_t __reint_842 = __s2_842; \
66348uint64x2_t __reint1_842 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_842, __p3_842), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_842, __p3_842)}; \
66349 __ret_842 = __noswap_vcmlaq_rot90_f64(__rev0_842, __rev1_842, *(float64x2_t *) &__reint1_842); \
66350 __ret_842 = __builtin_shufflevector(__ret_842, __ret_842, 1, 0); \
66351 __ret_842; \
66352})
6656866353#endif
6656966354
6657066355#ifdef __LITTLE_ENDIAN__
66571__ai poly64x2_t vzip2q_p64(poly64x2_t __p0, poly64x2_t __p1) {
66572 poly64x2_t __ret;
66573 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
66574 return __ret;
66575}
66356#define vcmla_rot90_laneq_f64(__p0_843, __p1_843, __p2_843, __p3_843) __extension__ ({ \
66357 float64x1_t __ret_843; \
66358 float64x1_t __s0_843 = __p0_843; \
66359 float64x1_t __s1_843 = __p1_843; \
66360 float64x2_t __s2_843 = __p2_843; \
66361float64x2_t __reint_843 = __s2_843; \
66362uint64x2_t __reint1_843 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_843, __p3_843), vgetq_lane_u64(*(uint64x2_t *) &__reint_843, __p3_843)}; \
66363 __ret_843 = vcmla_rot90_f64(__s0_843, __s1_843, *(float64x1_t *) &__reint1_843); \
66364 __ret_843; \
66365})
6657666366#else
66577__ai poly64x2_t vzip2q_p64(poly64x2_t __p0, poly64x2_t __p1) {
66578 poly64x2_t __ret;
66579 poly64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66580 poly64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
66581 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
66582 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
66583 return __ret;
66584}
66367#define vcmla_rot90_laneq_f64(__p0_844, __p1_844, __p2_844, __p3_844) __extension__ ({ \
66368 float64x1_t __ret_844; \
66369 float64x1_t __s0_844 = __p0_844; \
66370 float64x1_t __s1_844 = __p1_844; \
66371 float64x2_t __s2_844 = __p2_844; \
66372 float64x2_t __rev2_844; __rev2_844 = __builtin_shufflevector(__s2_844, __s2_844, 1, 0); \
66373float64x2_t __reint_844 = __rev2_844; \
66374uint64x2_t __reint1_844 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_844, __p3_844), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_844, __p3_844)}; \
66375 __ret_844 = vcmla_rot90_f64(__s0_844, __s1_844, *(float64x1_t *) &__reint1_844); \
66376 __ret_844; \
66377})
6658566378#endif
6658666379
6658766380#ifdef __LITTLE_ENDIAN__
66588__ai poly16x8_t vzip2q_p16(poly16x8_t __p0, poly16x8_t __p1) {
66589 poly16x8_t __ret;
66590 __ret = __builtin_shufflevector(__p0, __p1, 4, 12, 5, 13, 6, 14, 7, 15);
66591 return __ret;
66592}
66381#define vcmlaq_rot90_laneq_f64(__p0_845, __p1_845, __p2_845, __p3_845) __extension__ ({ \
66382 float64x2_t __ret_845; \
66383 float64x2_t __s0_845 = __p0_845; \
66384 float64x2_t __s1_845 = __p1_845; \
66385 float64x2_t __s2_845 = __p2_845; \
66386float64x2_t __reint_845 = __s2_845; \
66387uint64x2_t __reint1_845 = (uint64x2_t) {vgetq_lane_u64(*(uint64x2_t *) &__reint_845, __p3_845), vgetq_lane_u64(*(uint64x2_t *) &__reint_845, __p3_845)}; \
66388 __ret_845 = vcmlaq_rot90_f64(__s0_845, __s1_845, *(float64x2_t *) &__reint1_845); \
66389 __ret_845; \
66390})
6659366391#else
66594__ai poly16x8_t vzip2q_p16(poly16x8_t __p0, poly16x8_t __p1) {
66595 poly16x8_t __ret;
66596 poly16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
66597 poly16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
66598 __ret = __builtin_shufflevector(__rev0, __rev1, 4, 12, 5, 13, 6, 14, 7, 15);
66599 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
66600 return __ret;
66601}
66392#define vcmlaq_rot90_laneq_f64(__p0_846, __p1_846, __p2_846, __p3_846) __extension__ ({ \
66393 float64x2_t __ret_846; \
66394 float64x2_t __s0_846 = __p0_846; \
66395 float64x2_t __s1_846 = __p1_846; \
66396 float64x2_t __s2_846 = __p2_846; \
66397 float64x2_t __rev0_846; __rev0_846 = __builtin_shufflevector(__s0_846, __s0_846, 1, 0); \
66398 float64x2_t __rev1_846; __rev1_846 = __builtin_shufflevector(__s1_846, __s1_846, 1, 0); \
66399 float64x2_t __rev2_846; __rev2_846 = __builtin_shufflevector(__s2_846, __s2_846, 1, 0); \
66400float64x2_t __reint_846 = __rev2_846; \
66401uint64x2_t __reint1_846 = (uint64x2_t) {__noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_846, __p3_846), __noswap_vgetq_lane_u64(*(uint64x2_t *) &__reint_846, __p3_846)}; \
66402 __ret_846 = __noswap_vcmlaq_rot90_f64(__rev0_846, __rev1_846, *(float64x2_t *) &__reint1_846); \
66403 __ret_846 = __builtin_shufflevector(__ret_846, __ret_846, 1, 0); \
66404 __ret_846; \
66405})
6660266406#endif
6660366407
6660466408#ifdef __LITTLE_ENDIAN__
66605__ai uint8x16_t vzip2q_u8(uint8x16_t __p0, uint8x16_t __p1) {
66606 uint8x16_t __ret;
66607 __ret = __builtin_shufflevector(__p0, __p1, 8, 24, 9, 25, 10, 26, 11, 27, 12, 28, 13, 29, 14, 30, 15, 31);
66409__ai __attribute__((target("v8.5a"))) float32x4_t vrnd32xq_f32(float32x4_t __p0) {
66410 float32x4_t __ret;
66411 __ret = (float32x4_t) __builtin_neon_vrnd32xq_f32((int8x16_t)__p0, 41);
6660866412 return __ret;
6660966413}
6661066414#else
66611__ai uint8x16_t vzip2q_u8(uint8x16_t __p0, uint8x16_t __p1) {
66612 uint8x16_t __ret;
66613 uint8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
66614 uint8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
66615 __ret = __builtin_shufflevector(__rev0, __rev1, 8, 24, 9, 25, 10, 26, 11, 27, 12, 28, 13, 29, 14, 30, 15, 31);
66616 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
66415__ai __attribute__((target("v8.5a"))) float32x4_t vrnd32xq_f32(float32x4_t __p0) {
66416 float32x4_t __ret;
66417 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
66418 __ret = (float32x4_t) __builtin_neon_vrnd32xq_f32((int8x16_t)__rev0, 41);
66419 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6661766420 return __ret;
6661866421}
6661966422#endif
6662066423
6662166424#ifdef __LITTLE_ENDIAN__
66622__ai uint32x4_t vzip2q_u32(uint32x4_t __p0, uint32x4_t __p1) {
66623 uint32x4_t __ret;
66624 __ret = __builtin_shufflevector(__p0, __p1, 2, 6, 3, 7);
66425__ai __attribute__((target("v8.5a"))) float32x2_t vrnd32x_f32(float32x2_t __p0) {
66426 float32x2_t __ret;
66427 __ret = (float32x2_t) __builtin_neon_vrnd32x_f32((int8x8_t)__p0, 9);
6662566428 return __ret;
6662666429}
6662766430#else
66628__ai uint32x4_t vzip2q_u32(uint32x4_t __p0, uint32x4_t __p1) {
66629 uint32x4_t __ret;
66630 uint32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
66631 uint32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
66632 __ret = __builtin_shufflevector(__rev0, __rev1, 2, 6, 3, 7);
66633 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
66431__ai __attribute__((target("v8.5a"))) float32x2_t vrnd32x_f32(float32x2_t __p0) {
66432 float32x2_t __ret;
66433 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66434 __ret = (float32x2_t) __builtin_neon_vrnd32x_f32((int8x8_t)__rev0, 9);
66435 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6663466436 return __ret;
6663566437}
6663666438#endif
6663766439
6663866440#ifdef __LITTLE_ENDIAN__
66639__ai uint64x2_t vzip2q_u64(uint64x2_t __p0, uint64x2_t __p1) {
66640 uint64x2_t __ret;
66641 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
66441__ai __attribute__((target("v8.5a"))) float32x4_t vrnd32zq_f32(float32x4_t __p0) {
66442 float32x4_t __ret;
66443 __ret = (float32x4_t) __builtin_neon_vrnd32zq_f32((int8x16_t)__p0, 41);
6664266444 return __ret;
6664366445}
6664466446#else
66645__ai uint64x2_t vzip2q_u64(uint64x2_t __p0, uint64x2_t __p1) {
66646 uint64x2_t __ret;
66647 uint64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66648 uint64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
66649 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
66650 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
66447__ai __attribute__((target("v8.5a"))) float32x4_t vrnd32zq_f32(float32x4_t __p0) {
66448 float32x4_t __ret;
66449 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
66450 __ret = (float32x4_t) __builtin_neon_vrnd32zq_f32((int8x16_t)__rev0, 41);
66451 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6665166452 return __ret;
6665266453}
6665366454#endif
6665466455
6665566456#ifdef __LITTLE_ENDIAN__
66656__ai uint16x8_t vzip2q_u16(uint16x8_t __p0, uint16x8_t __p1) {
66657 uint16x8_t __ret;
66658 __ret = __builtin_shufflevector(__p0, __p1, 4, 12, 5, 13, 6, 14, 7, 15);
66457__ai __attribute__((target("v8.5a"))) float32x2_t vrnd32z_f32(float32x2_t __p0) {
66458 float32x2_t __ret;
66459 __ret = (float32x2_t) __builtin_neon_vrnd32z_f32((int8x8_t)__p0, 9);
6665966460 return __ret;
6666066461}
6666166462#else
66662__ai uint16x8_t vzip2q_u16(uint16x8_t __p0, uint16x8_t __p1) {
66663 uint16x8_t __ret;
66664 uint16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
66665 uint16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
66666 __ret = __builtin_shufflevector(__rev0, __rev1, 4, 12, 5, 13, 6, 14, 7, 15);
66667 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
66463__ai __attribute__((target("v8.5a"))) float32x2_t vrnd32z_f32(float32x2_t __p0) {
66464 float32x2_t __ret;
66465 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66466 __ret = (float32x2_t) __builtin_neon_vrnd32z_f32((int8x8_t)__rev0, 9);
66467 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6666866468 return __ret;
6666966469}
6667066470#endif
6667166471
6667266472#ifdef __LITTLE_ENDIAN__
66673__ai int8x16_t vzip2q_s8(int8x16_t __p0, int8x16_t __p1) {
66674 int8x16_t __ret;
66675 __ret = __builtin_shufflevector(__p0, __p1, 8, 24, 9, 25, 10, 26, 11, 27, 12, 28, 13, 29, 14, 30, 15, 31);
66473__ai __attribute__((target("v8.5a"))) float32x4_t vrnd64xq_f32(float32x4_t __p0) {
66474 float32x4_t __ret;
66475 __ret = (float32x4_t) __builtin_neon_vrnd64xq_f32((int8x16_t)__p0, 41);
6667666476 return __ret;
6667766477}
6667866478#else
66679__ai int8x16_t vzip2q_s8(int8x16_t __p0, int8x16_t __p1) {
66680 int8x16_t __ret;
66681 int8x16_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
66682 int8x16_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
66683 __ret = __builtin_shufflevector(__rev0, __rev1, 8, 24, 9, 25, 10, 26, 11, 27, 12, 28, 13, 29, 14, 30, 15, 31);
66684 __ret = __builtin_shufflevector(__ret, __ret, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0);
66479__ai __attribute__((target("v8.5a"))) float32x4_t vrnd64xq_f32(float32x4_t __p0) {
66480 float32x4_t __ret;
66481 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
66482 __ret = (float32x4_t) __builtin_neon_vrnd64xq_f32((int8x16_t)__rev0, 41);
66483 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6668566484 return __ret;
6668666485}
6668766486#endif
6668866487
6668966488#ifdef __LITTLE_ENDIAN__
66690__ai float64x2_t vzip2q_f64(float64x2_t __p0, float64x2_t __p1) {
66691 float64x2_t __ret;
66692 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
66489__ai __attribute__((target("v8.5a"))) float32x2_t vrnd64x_f32(float32x2_t __p0) {
66490 float32x2_t __ret;
66491 __ret = (float32x2_t) __builtin_neon_vrnd64x_f32((int8x8_t)__p0, 9);
6669366492 return __ret;
6669466493}
6669566494#else
66696__ai float64x2_t vzip2q_f64(float64x2_t __p0, float64x2_t __p1) {
66697 float64x2_t __ret;
66698 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66699 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
66700 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
66495__ai __attribute__((target("v8.5a"))) float32x2_t vrnd64x_f32(float32x2_t __p0) {
66496 float32x2_t __ret;
66497 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66498 __ret = (float32x2_t) __builtin_neon_vrnd64x_f32((int8x8_t)__rev0, 9);
6670166499 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6670266500 return __ret;
6670366501}
6670466502#endif
6670566503
6670666504#ifdef __LITTLE_ENDIAN__
66707__ai float32x4_t vzip2q_f32(float32x4_t __p0, float32x4_t __p1) {
66505__ai __attribute__((target("v8.5a"))) float32x4_t vrnd64zq_f32(float32x4_t __p0) {
6670866506 float32x4_t __ret;
66709 __ret = __builtin_shufflevector(__p0, __p1, 2, 6, 3, 7);
66507 __ret = (float32x4_t) __builtin_neon_vrnd64zq_f32((int8x16_t)__p0, 41);
6671066508 return __ret;
6671166509}
6671266510#else
66713__ai float32x4_t vzip2q_f32(float32x4_t __p0, float32x4_t __p1) {
66511__ai __attribute__((target("v8.5a"))) float32x4_t vrnd64zq_f32(float32x4_t __p0) {
6671466512 float32x4_t __ret;
6671566513 float32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
66716 float32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
66717 __ret = __builtin_shufflevector(__rev0, __rev1, 2, 6, 3, 7);
66514 __ret = (float32x4_t) __builtin_neon_vrnd64zq_f32((int8x16_t)__rev0, 41);
6671866515 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
6671966516 return __ret;
6672066517}
6672166518#endif
6672266519
6672366520#ifdef __LITTLE_ENDIAN__
66724__ai int32x4_t vzip2q_s32(int32x4_t __p0, int32x4_t __p1) {
66725 int32x4_t __ret;
66726 __ret = __builtin_shufflevector(__p0, __p1, 2, 6, 3, 7);
66521__ai __attribute__((target("v8.5a"))) float32x2_t vrnd64z_f32(float32x2_t __p0) {
66522 float32x2_t __ret;
66523 __ret = (float32x2_t) __builtin_neon_vrnd64z_f32((int8x8_t)__p0, 9);
6672766524 return __ret;
6672866525}
6672966526#else
66730__ai int32x4_t vzip2q_s32(int32x4_t __p0, int32x4_t __p1) {
66731 int32x4_t __ret;
66732 int32x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
66733 int32x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
66734 __ret = __builtin_shufflevector(__rev0, __rev1, 2, 6, 3, 7);
66735 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
66527__ai __attribute__((target("v8.5a"))) float32x2_t vrnd64z_f32(float32x2_t __p0) {
66528 float32x2_t __ret;
66529 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66530 __ret = (float32x2_t) __builtin_neon_vrnd64z_f32((int8x8_t)__rev0, 9);
66531 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6673666532 return __ret;
6673766533}
6673866534#endif
6673966535
66536#endif
66537#if defined(__aarch64__) && defined(__ARM_FEATURE_DIRECTED_ROUNDING)
6674066538#ifdef __LITTLE_ENDIAN__
66741__ai int64x2_t vzip2q_s64(int64x2_t __p0, int64x2_t __p1) {
66742 int64x2_t __ret;
66743 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
66539__ai float64x2_t vrndq_f64(float64x2_t __p0) {
66540 float64x2_t __ret;
66541 __ret = (float64x2_t) __builtin_neon_vrndq_v((int8x16_t)__p0, 42);
6674466542 return __ret;
6674566543}
6674666544#else
66747__ai int64x2_t vzip2q_s64(int64x2_t __p0, int64x2_t __p1) {
66748 int64x2_t __ret;
66749 int64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66750 int64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
66751 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
66545__ai float64x2_t vrndq_f64(float64x2_t __p0) {
66546 float64x2_t __ret;
66547 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66548 __ret = (float64x2_t) __builtin_neon_vrndq_v((int8x16_t)__rev0, 42);
6675266549 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6675366550 return __ret;
6675466551}
6675566552#endif
6675666553
66554__ai float64x1_t vrnd_f64(float64x1_t __p0) {
66555 float64x1_t __ret;
66556 __ret = (float64x1_t) __builtin_neon_vrnd_v((int8x8_t)__p0, 10);
66557 return __ret;
66558}
6675766559#ifdef __LITTLE_ENDIAN__
66758__ai int16x8_t vzip2q_s16(int16x8_t __p0, int16x8_t __p1) {
66759 int16x8_t __ret;
66760 __ret = __builtin_shufflevector(__p0, __p1, 4, 12, 5, 13, 6, 14, 7, 15);
66560__ai float64x2_t vrndaq_f64(float64x2_t __p0) {
66561 float64x2_t __ret;
66562 __ret = (float64x2_t) __builtin_neon_vrndaq_v((int8x16_t)__p0, 42);
6676166563 return __ret;
6676266564}
6676366565#else
66764__ai int16x8_t vzip2q_s16(int16x8_t __p0, int16x8_t __p1) {
66765 int16x8_t __ret;
66766 int16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
66767 int16x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
66768 __ret = __builtin_shufflevector(__rev0, __rev1, 4, 12, 5, 13, 6, 14, 7, 15);
66769 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
66566__ai float64x2_t vrndaq_f64(float64x2_t __p0) {
66567 float64x2_t __ret;
66568 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66569 __ret = (float64x2_t) __builtin_neon_vrndaq_v((int8x16_t)__rev0, 42);
66570 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6677066571 return __ret;
6677166572}
6677266573#endif
6677366574
66575__ai float64x1_t vrnda_f64(float64x1_t __p0) {
66576 float64x1_t __ret;
66577 __ret = (float64x1_t) __builtin_neon_vrnda_v((int8x8_t)__p0, 10);
66578 return __ret;
66579}
6677466580#ifdef __LITTLE_ENDIAN__
66775__ai uint8x8_t vzip2_u8(uint8x8_t __p0, uint8x8_t __p1) {
66776 uint8x8_t __ret;
66777 __ret = __builtin_shufflevector(__p0, __p1, 4, 12, 5, 13, 6, 14, 7, 15);
66581__ai float64x2_t vrndiq_f64(float64x2_t __p0) {
66582 float64x2_t __ret;
66583 __ret = (float64x2_t) __builtin_neon_vrndiq_v((int8x16_t)__p0, 42);
6677866584 return __ret;
6677966585}
6678066586#else
66781__ai uint8x8_t vzip2_u8(uint8x8_t __p0, uint8x8_t __p1) {
66782 uint8x8_t __ret;
66783 uint8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
66784 uint8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
66785 __ret = __builtin_shufflevector(__rev0, __rev1, 4, 12, 5, 13, 6, 14, 7, 15);
66786 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
66587__ai float64x2_t vrndiq_f64(float64x2_t __p0) {
66588 float64x2_t __ret;
66589 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66590 __ret = (float64x2_t) __builtin_neon_vrndiq_v((int8x16_t)__rev0, 42);
66591 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6678766592 return __ret;
6678866593}
6678966594#endif
6679066595
66596__ai float64x1_t vrndi_f64(float64x1_t __p0) {
66597 float64x1_t __ret;
66598 __ret = (float64x1_t) __builtin_neon_vrndi_v((int8x8_t)__p0, 10);
66599 return __ret;
66600}
6679166601#ifdef __LITTLE_ENDIAN__
66792__ai uint32x2_t vzip2_u32(uint32x2_t __p0, uint32x2_t __p1) {
66793 uint32x2_t __ret;
66794 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
66602__ai float64x2_t vrndmq_f64(float64x2_t __p0) {
66603 float64x2_t __ret;
66604 __ret = (float64x2_t) __builtin_neon_vrndmq_v((int8x16_t)__p0, 42);
6679566605 return __ret;
6679666606}
6679766607#else
66798__ai uint32x2_t vzip2_u32(uint32x2_t __p0, uint32x2_t __p1) {
66799 uint32x2_t __ret;
66800 uint32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66801 uint32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
66802 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
66608__ai float64x2_t vrndmq_f64(float64x2_t __p0) {
66609 float64x2_t __ret;
66610 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66611 __ret = (float64x2_t) __builtin_neon_vrndmq_v((int8x16_t)__rev0, 42);
6680366612 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6680466613 return __ret;
6680566614}
6680666615#endif
6680766616
66617__ai float64x1_t vrndm_f64(float64x1_t __p0) {
66618 float64x1_t __ret;
66619 __ret = (float64x1_t) __builtin_neon_vrndm_v((int8x8_t)__p0, 10);
66620 return __ret;
66621}
6680866622#ifdef __LITTLE_ENDIAN__
66809__ai uint16x4_t vzip2_u16(uint16x4_t __p0, uint16x4_t __p1) {
66810 uint16x4_t __ret;
66811 __ret = __builtin_shufflevector(__p0, __p1, 2, 6, 3, 7);
66623__ai float64x2_t vrndnq_f64(float64x2_t __p0) {
66624 float64x2_t __ret;
66625 __ret = (float64x2_t) __builtin_neon_vrndnq_v((int8x16_t)__p0, 42);
6681266626 return __ret;
6681366627}
6681466628#else
66815__ai uint16x4_t vzip2_u16(uint16x4_t __p0, uint16x4_t __p1) {
66816 uint16x4_t __ret;
66817 uint16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
66818 uint16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
66819 __ret = __builtin_shufflevector(__rev0, __rev1, 2, 6, 3, 7);
66820 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
66629__ai float64x2_t vrndnq_f64(float64x2_t __p0) {
66630 float64x2_t __ret;
66631 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66632 __ret = (float64x2_t) __builtin_neon_vrndnq_v((int8x16_t)__rev0, 42);
66633 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6682166634 return __ret;
6682266635}
6682366636#endif
6682466637
66638__ai float64x1_t vrndn_f64(float64x1_t __p0) {
66639 float64x1_t __ret;
66640 __ret = (float64x1_t) __builtin_neon_vrndn_v((int8x8_t)__p0, 10);
66641 return __ret;
66642}
6682566643#ifdef __LITTLE_ENDIAN__
66826__ai int8x8_t vzip2_s8(int8x8_t __p0, int8x8_t __p1) {
66827 int8x8_t __ret;
66828 __ret = __builtin_shufflevector(__p0, __p1, 4, 12, 5, 13, 6, 14, 7, 15);
66644__ai float64x2_t vrndpq_f64(float64x2_t __p0) {
66645 float64x2_t __ret;
66646 __ret = (float64x2_t) __builtin_neon_vrndpq_v((int8x16_t)__p0, 42);
6682966647 return __ret;
6683066648}
6683166649#else
66832__ai int8x8_t vzip2_s8(int8x8_t __p0, int8x8_t __p1) {
66833 int8x8_t __ret;
66834 int8x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
66835 int8x8_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 7, 6, 5, 4, 3, 2, 1, 0);
66836 __ret = __builtin_shufflevector(__rev0, __rev1, 4, 12, 5, 13, 6, 14, 7, 15);
66837 __ret = __builtin_shufflevector(__ret, __ret, 7, 6, 5, 4, 3, 2, 1, 0);
66650__ai float64x2_t vrndpq_f64(float64x2_t __p0) {
66651 float64x2_t __ret;
66652 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66653 __ret = (float64x2_t) __builtin_neon_vrndpq_v((int8x16_t)__rev0, 42);
66654 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6683866655 return __ret;
6683966656}
6684066657#endif
6684166658
66659__ai float64x1_t vrndp_f64(float64x1_t __p0) {
66660 float64x1_t __ret;
66661 __ret = (float64x1_t) __builtin_neon_vrndp_v((int8x8_t)__p0, 10);
66662 return __ret;
66663}
6684266664#ifdef __LITTLE_ENDIAN__
66843__ai float32x2_t vzip2_f32(float32x2_t __p0, float32x2_t __p1) {
66844 float32x2_t __ret;
66845 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
66665__ai float64x2_t vrndxq_f64(float64x2_t __p0) {
66666 float64x2_t __ret;
66667 __ret = (float64x2_t) __builtin_neon_vrndxq_v((int8x16_t)__p0, 42);
6684666668 return __ret;
6684766669}
6684866670#else
66849__ai float32x2_t vzip2_f32(float32x2_t __p0, float32x2_t __p1) {
66850 float32x2_t __ret;
66851 float32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66852 float32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
66853 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
66671__ai float64x2_t vrndxq_f64(float64x2_t __p0) {
66672 float64x2_t __ret;
66673 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66674 __ret = (float64x2_t) __builtin_neon_vrndxq_v((int8x16_t)__rev0, 42);
6685466675 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6685566676 return __ret;
6685666677}
6685766678#endif
6685866679
66680__ai float64x1_t vrndx_f64(float64x1_t __p0) {
66681 float64x1_t __ret;
66682 __ret = (float64x1_t) __builtin_neon_vrndx_v((int8x8_t)__p0, 10);
66683 return __ret;
66684}
66685#endif
66686#if defined(__aarch64__) && defined(__ARM_FEATURE_NUMERIC_MAXMIN)
6685966687#ifdef __LITTLE_ENDIAN__
66860__ai int32x2_t vzip2_s32(int32x2_t __p0, int32x2_t __p1) {
66861 int32x2_t __ret;
66862 __ret = __builtin_shufflevector(__p0, __p1, 1, 3);
66688__ai float64x2_t vmaxnmq_f64(float64x2_t __p0, float64x2_t __p1) {
66689 float64x2_t __ret;
66690 __ret = (float64x2_t) __builtin_neon_vmaxnmq_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
6686366691 return __ret;
6686466692}
6686566693#else
66866__ai int32x2_t vzip2_s32(int32x2_t __p0, int32x2_t __p1) {
66867 int32x2_t __ret;
66868 int32x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66869 int32x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
66870 __ret = __builtin_shufflevector(__rev0, __rev1, 1, 3);
66694__ai float64x2_t vmaxnmq_f64(float64x2_t __p0, float64x2_t __p1) {
66695 float64x2_t __ret;
66696 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66697 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
66698 __ret = (float64x2_t) __builtin_neon_vmaxnmq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
6687166699 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6687266700 return __ret;
6687366701}
6687466702#endif
6687566703
66704__ai float64x1_t vmaxnm_f64(float64x1_t __p0, float64x1_t __p1) {
66705 float64x1_t __ret;
66706 __ret = (float64x1_t) __builtin_neon_vmaxnm_v((int8x8_t)__p0, (int8x8_t)__p1, 10);
66707 return __ret;
66708}
6687666709#ifdef __LITTLE_ENDIAN__
66877__ai int16x4_t vzip2_s16(int16x4_t __p0, int16x4_t __p1) {
66878 int16x4_t __ret;
66879 __ret = __builtin_shufflevector(__p0, __p1, 2, 6, 3, 7);
66710__ai float64x2_t vminnmq_f64(float64x2_t __p0, float64x2_t __p1) {
66711 float64x2_t __ret;
66712 __ret = (float64x2_t) __builtin_neon_vminnmq_v((int8x16_t)__p0, (int8x16_t)__p1, 42);
6688066713 return __ret;
6688166714}
6688266715#else
66883__ai int16x4_t vzip2_s16(int16x4_t __p0, int16x4_t __p1) {
66884 int16x4_t __ret;
66885 int16x4_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 3, 2, 1, 0);
66886 int16x4_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 3, 2, 1, 0);
66887 __ret = __builtin_shufflevector(__rev0, __rev1, 2, 6, 3, 7);
66888 __ret = __builtin_shufflevector(__ret, __ret, 3, 2, 1, 0);
66716__ai float64x2_t vminnmq_f64(float64x2_t __p0, float64x2_t __p1) {
66717 float64x2_t __ret;
66718 float64x2_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 1, 0);
66719 float64x2_t __rev1; __rev1 = __builtin_shufflevector(__p1, __p1, 1, 0);
66720 __ret = (float64x2_t) __builtin_neon_vminnmq_v((int8x16_t)__rev0, (int8x16_t)__rev1, 42);
66721 __ret = __builtin_shufflevector(__ret, __ret, 1, 0);
6688966722 return __ret;
6689066723}
6689166724#endif
6689266725
66726__ai float64x1_t vminnm_f64(float64x1_t __p0, float64x1_t __p1) {
66727 float64x1_t __ret;
66728 __ret = (float64x1_t) __builtin_neon_vminnm_v((int8x8_t)__p0, (int8x8_t)__p1, 10);
66729 return __ret;
66730}
6689366731#endif
6689466732#ifdef __LITTLE_ENDIAN__
6689566733__ai uint8x16_t vabaq_u8(uint8x16_t __p0, uint8x16_t __p1, uint8x16_t __p2) {
......@@ -67444,60 +67282,60 @@ __ai int32x4_t vaddw_s16(int32x4_t __p0, int16x4_t __p1) {
6744467282#endif
6744567283
6744667284#ifdef __LITTLE_ENDIAN__
67447#define vget_lane_f16(__p0_851, __p1_851) __extension__ ({ \
67448 float16_t __ret_851; \
67449 float16x4_t __s0_851 = __p0_851; \
67450float16x4_t __reint_851 = __s0_851; \
67451int16_t __reint1_851 = vget_lane_s16(*(int16x4_t *) &__reint_851, __p1_851); \
67452 __ret_851 = *(float16_t *) &__reint1_851; \
67453 __ret_851; \
67285#define vget_lane_f16(__p0_847, __p1_847) __extension__ ({ \
67286 float16_t __ret_847; \
67287 float16x4_t __s0_847 = __p0_847; \
67288float16x4_t __reint_847 = __s0_847; \
67289int16_t __reint1_847 = vget_lane_s16(*(int16x4_t *) &__reint_847, __p1_847); \
67290 __ret_847 = *(float16_t *) &__reint1_847; \
67291 __ret_847; \
6745467292})
6745567293#else
67456#define vget_lane_f16(__p0_852, __p1_852) __extension__ ({ \
67457 float16_t __ret_852; \
67458 float16x4_t __s0_852 = __p0_852; \
67459 float16x4_t __rev0_852; __rev0_852 = __builtin_shufflevector(__s0_852, __s0_852, 3, 2, 1, 0); \
67460float16x4_t __reint_852 = __rev0_852; \
67461int16_t __reint1_852 = __noswap_vget_lane_s16(*(int16x4_t *) &__reint_852, __p1_852); \
67462 __ret_852 = *(float16_t *) &__reint1_852; \
67463 __ret_852; \
67294#define vget_lane_f16(__p0_848, __p1_848) __extension__ ({ \
67295 float16_t __ret_848; \
67296 float16x4_t __s0_848 = __p0_848; \
67297 float16x4_t __rev0_848; __rev0_848 = __builtin_shufflevector(__s0_848, __s0_848, 3, 2, 1, 0); \
67298float16x4_t __reint_848 = __rev0_848; \
67299int16_t __reint1_848 = __noswap_vget_lane_s16(*(int16x4_t *) &__reint_848, __p1_848); \
67300 __ret_848 = *(float16_t *) &__reint1_848; \
67301 __ret_848; \
6746467302})
67465#define __noswap_vget_lane_f16(__p0_853, __p1_853) __extension__ ({ \
67466 float16_t __ret_853; \
67467 float16x4_t __s0_853 = __p0_853; \
67468float16x4_t __reint_853 = __s0_853; \
67469int16_t __reint1_853 = __noswap_vget_lane_s16(*(int16x4_t *) &__reint_853, __p1_853); \
67470 __ret_853 = *(float16_t *) &__reint1_853; \
67471 __ret_853; \
67303#define __noswap_vget_lane_f16(__p0_849, __p1_849) __extension__ ({ \
67304 float16_t __ret_849; \
67305 float16x4_t __s0_849 = __p0_849; \
67306float16x4_t __reint_849 = __s0_849; \
67307int16_t __reint1_849 = __noswap_vget_lane_s16(*(int16x4_t *) &__reint_849, __p1_849); \
67308 __ret_849 = *(float16_t *) &__reint1_849; \
67309 __ret_849; \
6747267310})
6747367311#endif
6747467312
6747567313#ifdef __LITTLE_ENDIAN__
67476#define vgetq_lane_f16(__p0_854, __p1_854) __extension__ ({ \
67477 float16_t __ret_854; \
67478 float16x8_t __s0_854 = __p0_854; \
67479float16x8_t __reint_854 = __s0_854; \
67480int16_t __reint1_854 = vgetq_lane_s16(*(int16x8_t *) &__reint_854, __p1_854); \
67481 __ret_854 = *(float16_t *) &__reint1_854; \
67482 __ret_854; \
67314#define vgetq_lane_f16(__p0_850, __p1_850) __extension__ ({ \
67315 float16_t __ret_850; \
67316 float16x8_t __s0_850 = __p0_850; \
67317float16x8_t __reint_850 = __s0_850; \
67318int16_t __reint1_850 = vgetq_lane_s16(*(int16x8_t *) &__reint_850, __p1_850); \
67319 __ret_850 = *(float16_t *) &__reint1_850; \
67320 __ret_850; \
6748367321})
6748467322#else
67485#define vgetq_lane_f16(__p0_855, __p1_855) __extension__ ({ \
67486 float16_t __ret_855; \
67487 float16x8_t __s0_855 = __p0_855; \
67488 float16x8_t __rev0_855; __rev0_855 = __builtin_shufflevector(__s0_855, __s0_855, 7, 6, 5, 4, 3, 2, 1, 0); \
67489float16x8_t __reint_855 = __rev0_855; \
67490int16_t __reint1_855 = __noswap_vgetq_lane_s16(*(int16x8_t *) &__reint_855, __p1_855); \
67491 __ret_855 = *(float16_t *) &__reint1_855; \
67492 __ret_855; \
67323#define vgetq_lane_f16(__p0_851, __p1_851) __extension__ ({ \
67324 float16_t __ret_851; \
67325 float16x8_t __s0_851 = __p0_851; \
67326 float16x8_t __rev0_851; __rev0_851 = __builtin_shufflevector(__s0_851, __s0_851, 7, 6, 5, 4, 3, 2, 1, 0); \
67327float16x8_t __reint_851 = __rev0_851; \
67328int16_t __reint1_851 = __noswap_vgetq_lane_s16(*(int16x8_t *) &__reint_851, __p1_851); \
67329 __ret_851 = *(float16_t *) &__reint1_851; \
67330 __ret_851; \
6749367331})
67494#define __noswap_vgetq_lane_f16(__p0_856, __p1_856) __extension__ ({ \
67495 float16_t __ret_856; \
67496 float16x8_t __s0_856 = __p0_856; \
67497float16x8_t __reint_856 = __s0_856; \
67498int16_t __reint1_856 = __noswap_vgetq_lane_s16(*(int16x8_t *) &__reint_856, __p1_856); \
67499 __ret_856 = *(float16_t *) &__reint1_856; \
67500 __ret_856; \
67332#define __noswap_vgetq_lane_f16(__p0_852, __p1_852) __extension__ ({ \
67333 float16_t __ret_852; \
67334 float16x8_t __s0_852 = __p0_852; \
67335float16x8_t __reint_852 = __s0_852; \
67336int16_t __reint1_852 = __noswap_vgetq_lane_s16(*(int16x8_t *) &__reint_852, __p1_852); \
67337 __ret_852 = *(float16_t *) &__reint1_852; \
67338 __ret_852; \
6750167339})
6750267340#endif
6750367341
......@@ -67640,98 +67478,98 @@ __ai int32x4_t __noswap_vmlal_s16(int32x4_t __p0, int16x4_t __p1, int16x4_t __p2
6764067478#endif
6764167479
6764267480#ifdef __LITTLE_ENDIAN__
67643#define vmlal_lane_u32(__p0_857, __p1_857, __p2_857, __p3_857) __extension__ ({ \
67644 uint64x2_t __ret_857; \
67645 uint64x2_t __s0_857 = __p0_857; \
67646 uint32x2_t __s1_857 = __p1_857; \
67647 uint32x2_t __s2_857 = __p2_857; \
67648 __ret_857 = __s0_857 + vmull_u32(__s1_857, splat_lane_u32(__s2_857, __p3_857)); \
67649 __ret_857; \
67481#define vmlal_lane_u32(__p0_853, __p1_853, __p2_853, __p3_853) __extension__ ({ \
67482 uint64x2_t __ret_853; \
67483 uint64x2_t __s0_853 = __p0_853; \
67484 uint32x2_t __s1_853 = __p1_853; \
67485 uint32x2_t __s2_853 = __p2_853; \
67486 __ret_853 = __s0_853 + vmull_u32(__s1_853, splat_lane_u32(__s2_853, __p3_853)); \
67487 __ret_853; \
6765067488})
6765167489#else
67652#define vmlal_lane_u32(__p0_858, __p1_858, __p2_858, __p3_858) __extension__ ({ \
67653 uint64x2_t __ret_858; \
67654 uint64x2_t __s0_858 = __p0_858; \
67655 uint32x2_t __s1_858 = __p1_858; \
67656 uint32x2_t __s2_858 = __p2_858; \
67657 uint64x2_t __rev0_858; __rev0_858 = __builtin_shufflevector(__s0_858, __s0_858, 1, 0); \
67658 uint32x2_t __rev1_858; __rev1_858 = __builtin_shufflevector(__s1_858, __s1_858, 1, 0); \
67659 uint32x2_t __rev2_858; __rev2_858 = __builtin_shufflevector(__s2_858, __s2_858, 1, 0); \
67660 __ret_858 = __rev0_858 + __noswap_vmull_u32(__rev1_858, __noswap_splat_lane_u32(__rev2_858, __p3_858)); \
67661 __ret_858 = __builtin_shufflevector(__ret_858, __ret_858, 1, 0); \
67662 __ret_858; \
67490#define vmlal_lane_u32(__p0_854, __p1_854, __p2_854, __p3_854) __extension__ ({ \
67491 uint64x2_t __ret_854; \
67492 uint64x2_t __s0_854 = __p0_854; \
67493 uint32x2_t __s1_854 = __p1_854; \
67494 uint32x2_t __s2_854 = __p2_854; \
67495 uint64x2_t __rev0_854; __rev0_854 = __builtin_shufflevector(__s0_854, __s0_854, 1, 0); \
67496 uint32x2_t __rev1_854; __rev1_854 = __builtin_shufflevector(__s1_854, __s1_854, 1, 0); \
67497 uint32x2_t __rev2_854; __rev2_854 = __builtin_shufflevector(__s2_854, __s2_854, 1, 0); \
67498 __ret_854 = __rev0_854 + __noswap_vmull_u32(__rev1_854, __noswap_splat_lane_u32(__rev2_854, __p3_854)); \
67499 __ret_854 = __builtin_shufflevector(__ret_854, __ret_854, 1, 0); \
67500 __ret_854; \
6766367501})
6766467502#endif
6766567503
6766667504#ifdef __LITTLE_ENDIAN__
67667#define vmlal_lane_u16(__p0_859, __p1_859, __p2_859, __p3_859) __extension__ ({ \
67668 uint32x4_t __ret_859; \
67669 uint32x4_t __s0_859 = __p0_859; \
67670 uint16x4_t __s1_859 = __p1_859; \
67671 uint16x4_t __s2_859 = __p2_859; \
67672 __ret_859 = __s0_859 + vmull_u16(__s1_859, splat_lane_u16(__s2_859, __p3_859)); \
67673 __ret_859; \
67505#define vmlal_lane_u16(__p0_855, __p1_855, __p2_855, __p3_855) __extension__ ({ \
67506 uint32x4_t __ret_855; \
67507 uint32x4_t __s0_855 = __p0_855; \
67508 uint16x4_t __s1_855 = __p1_855; \
67509 uint16x4_t __s2_855 = __p2_855; \
67510 __ret_855 = __s0_855 + vmull_u16(__s1_855, splat_lane_u16(__s2_855, __p3_855)); \
67511 __ret_855; \
6767467512})
6767567513#else
67676#define vmlal_lane_u16(__p0_860, __p1_860, __p2_860, __p3_860) __extension__ ({ \
67677 uint32x4_t __ret_860; \
67678 uint32x4_t __s0_860 = __p0_860; \
67679 uint16x4_t __s1_860 = __p1_860; \
67680 uint16x4_t __s2_860 = __p2_860; \
67681 uint32x4_t __rev0_860; __rev0_860 = __builtin_shufflevector(__s0_860, __s0_860, 3, 2, 1, 0); \
67682 uint16x4_t __rev1_860; __rev1_860 = __builtin_shufflevector(__s1_860, __s1_860, 3, 2, 1, 0); \
67683 uint16x4_t __rev2_860; __rev2_860 = __builtin_shufflevector(__s2_860, __s2_860, 3, 2, 1, 0); \
67684 __ret_860 = __rev0_860 + __noswap_vmull_u16(__rev1_860, __noswap_splat_lane_u16(__rev2_860, __p3_860)); \
67685 __ret_860 = __builtin_shufflevector(__ret_860, __ret_860, 3, 2, 1, 0); \
67686 __ret_860; \
67514#define vmlal_lane_u16(__p0_856, __p1_856, __p2_856, __p3_856) __extension__ ({ \
67515 uint32x4_t __ret_856; \
67516 uint32x4_t __s0_856 = __p0_856; \
67517 uint16x4_t __s1_856 = __p1_856; \
67518 uint16x4_t __s2_856 = __p2_856; \
67519 uint32x4_t __rev0_856; __rev0_856 = __builtin_shufflevector(__s0_856, __s0_856, 3, 2, 1, 0); \
67520 uint16x4_t __rev1_856; __rev1_856 = __builtin_shufflevector(__s1_856, __s1_856, 3, 2, 1, 0); \
67521 uint16x4_t __rev2_856; __rev2_856 = __builtin_shufflevector(__s2_856, __s2_856, 3, 2, 1, 0); \
67522 __ret_856 = __rev0_856 + __noswap_vmull_u16(__rev1_856, __noswap_splat_lane_u16(__rev2_856, __p3_856)); \
67523 __ret_856 = __builtin_shufflevector(__ret_856, __ret_856, 3, 2, 1, 0); \
67524 __ret_856; \
6768767525})
6768867526#endif
6768967527
6769067528#ifdef __LITTLE_ENDIAN__
67691#define vmlal_lane_s32(__p0_861, __p1_861, __p2_861, __p3_861) __extension__ ({ \
67692 int64x2_t __ret_861; \
67693 int64x2_t __s0_861 = __p0_861; \
67694 int32x2_t __s1_861 = __p1_861; \
67695 int32x2_t __s2_861 = __p2_861; \
67696 __ret_861 = __s0_861 + vmull_s32(__s1_861, splat_lane_s32(__s2_861, __p3_861)); \
67697 __ret_861; \
67529#define vmlal_lane_s32(__p0_857, __p1_857, __p2_857, __p3_857) __extension__ ({ \
67530 int64x2_t __ret_857; \
67531 int64x2_t __s0_857 = __p0_857; \
67532 int32x2_t __s1_857 = __p1_857; \
67533 int32x2_t __s2_857 = __p2_857; \
67534 __ret_857 = __s0_857 + vmull_s32(__s1_857, splat_lane_s32(__s2_857, __p3_857)); \
67535 __ret_857; \
6769867536})
6769967537#else
67700#define vmlal_lane_s32(__p0_862, __p1_862, __p2_862, __p3_862) __extension__ ({ \
67701 int64x2_t __ret_862; \
67702 int64x2_t __s0_862 = __p0_862; \
67703 int32x2_t __s1_862 = __p1_862; \
67704 int32x2_t __s2_862 = __p2_862; \
67705 int64x2_t __rev0_862; __rev0_862 = __builtin_shufflevector(__s0_862, __s0_862, 1, 0); \
67706 int32x2_t __rev1_862; __rev1_862 = __builtin_shufflevector(__s1_862, __s1_862, 1, 0); \
67707 int32x2_t __rev2_862; __rev2_862 = __builtin_shufflevector(__s2_862, __s2_862, 1, 0); \
67708 __ret_862 = __rev0_862 + __noswap_vmull_s32(__rev1_862, __noswap_splat_lane_s32(__rev2_862, __p3_862)); \
67709 __ret_862 = __builtin_shufflevector(__ret_862, __ret_862, 1, 0); \
67710 __ret_862; \
67538#define vmlal_lane_s32(__p0_858, __p1_858, __p2_858, __p3_858) __extension__ ({ \
67539 int64x2_t __ret_858; \
67540 int64x2_t __s0_858 = __p0_858; \
67541 int32x2_t __s1_858 = __p1_858; \
67542 int32x2_t __s2_858 = __p2_858; \
67543 int64x2_t __rev0_858; __rev0_858 = __builtin_shufflevector(__s0_858, __s0_858, 1, 0); \
67544 int32x2_t __rev1_858; __rev1_858 = __builtin_shufflevector(__s1_858, __s1_858, 1, 0); \
67545 int32x2_t __rev2_858; __rev2_858 = __builtin_shufflevector(__s2_858, __s2_858, 1, 0); \
67546 __ret_858 = __rev0_858 + __noswap_vmull_s32(__rev1_858, __noswap_splat_lane_s32(__rev2_858, __p3_858)); \
67547 __ret_858 = __builtin_shufflevector(__ret_858, __ret_858, 1, 0); \
67548 __ret_858; \
6771167549})
6771267550#endif
6771367551
6771467552#ifdef __LITTLE_ENDIAN__
67715#define vmlal_lane_s16(__p0_863, __p1_863, __p2_863, __p3_863) __extension__ ({ \
67716 int32x4_t __ret_863; \
67717 int32x4_t __s0_863 = __p0_863; \
67718 int16x4_t __s1_863 = __p1_863; \
67719 int16x4_t __s2_863 = __p2_863; \
67720 __ret_863 = __s0_863 + vmull_s16(__s1_863, splat_lane_s16(__s2_863, __p3_863)); \
67721 __ret_863; \
67553#define vmlal_lane_s16(__p0_859, __p1_859, __p2_859, __p3_859) __extension__ ({ \
67554 int32x4_t __ret_859; \
67555 int32x4_t __s0_859 = __p0_859; \
67556 int16x4_t __s1_859 = __p1_859; \
67557 int16x4_t __s2_859 = __p2_859; \
67558 __ret_859 = __s0_859 + vmull_s16(__s1_859, splat_lane_s16(__s2_859, __p3_859)); \
67559 __ret_859; \
6772267560})
6772367561#else
67724#define vmlal_lane_s16(__p0_864, __p1_864, __p2_864, __p3_864) __extension__ ({ \
67725 int32x4_t __ret_864; \
67726 int32x4_t __s0_864 = __p0_864; \
67727 int16x4_t __s1_864 = __p1_864; \
67728 int16x4_t __s2_864 = __p2_864; \
67729 int32x4_t __rev0_864; __rev0_864 = __builtin_shufflevector(__s0_864, __s0_864, 3, 2, 1, 0); \
67730 int16x4_t __rev1_864; __rev1_864 = __builtin_shufflevector(__s1_864, __s1_864, 3, 2, 1, 0); \
67731 int16x4_t __rev2_864; __rev2_864 = __builtin_shufflevector(__s2_864, __s2_864, 3, 2, 1, 0); \
67732 __ret_864 = __rev0_864 + __noswap_vmull_s16(__rev1_864, __noswap_splat_lane_s16(__rev2_864, __p3_864)); \
67733 __ret_864 = __builtin_shufflevector(__ret_864, __ret_864, 3, 2, 1, 0); \
67734 __ret_864; \
67562#define vmlal_lane_s16(__p0_860, __p1_860, __p2_860, __p3_860) __extension__ ({ \
67563 int32x4_t __ret_860; \
67564 int32x4_t __s0_860 = __p0_860; \
67565 int16x4_t __s1_860 = __p1_860; \
67566 int16x4_t __s2_860 = __p2_860; \
67567 int32x4_t __rev0_860; __rev0_860 = __builtin_shufflevector(__s0_860, __s0_860, 3, 2, 1, 0); \
67568 int16x4_t __rev1_860; __rev1_860 = __builtin_shufflevector(__s1_860, __s1_860, 3, 2, 1, 0); \
67569 int16x4_t __rev2_860; __rev2_860 = __builtin_shufflevector(__s2_860, __s2_860, 3, 2, 1, 0); \
67570 __ret_860 = __rev0_860 + __noswap_vmull_s16(__rev1_860, __noswap_splat_lane_s16(__rev2_860, __p3_860)); \
67571 __ret_860 = __builtin_shufflevector(__ret_860, __ret_860, 3, 2, 1, 0); \
67572 __ret_860; \
6773567573})
6773667574#endif
6773767575
......@@ -67962,98 +67800,98 @@ __ai int32x4_t __noswap_vmlsl_s16(int32x4_t __p0, int16x4_t __p1, int16x4_t __p2
6796267800#endif
6796367801
6796467802#ifdef __LITTLE_ENDIAN__
67965#define vmlsl_lane_u32(__p0_865, __p1_865, __p2_865, __p3_865) __extension__ ({ \
67966 uint64x2_t __ret_865; \
67967 uint64x2_t __s0_865 = __p0_865; \
67968 uint32x2_t __s1_865 = __p1_865; \
67969 uint32x2_t __s2_865 = __p2_865; \
67970 __ret_865 = __s0_865 - vmull_u32(__s1_865, splat_lane_u32(__s2_865, __p3_865)); \
67971 __ret_865; \
67803#define vmlsl_lane_u32(__p0_861, __p1_861, __p2_861, __p3_861) __extension__ ({ \
67804 uint64x2_t __ret_861; \
67805 uint64x2_t __s0_861 = __p0_861; \
67806 uint32x2_t __s1_861 = __p1_861; \
67807 uint32x2_t __s2_861 = __p2_861; \
67808 __ret_861 = __s0_861 - vmull_u32(__s1_861, splat_lane_u32(__s2_861, __p3_861)); \
67809 __ret_861; \
6797267810})
6797367811#else
67974#define vmlsl_lane_u32(__p0_866, __p1_866, __p2_866, __p3_866) __extension__ ({ \
67975 uint64x2_t __ret_866; \
67976 uint64x2_t __s0_866 = __p0_866; \
67977 uint32x2_t __s1_866 = __p1_866; \
67978 uint32x2_t __s2_866 = __p2_866; \
67979 uint64x2_t __rev0_866; __rev0_866 = __builtin_shufflevector(__s0_866, __s0_866, 1, 0); \
67980 uint32x2_t __rev1_866; __rev1_866 = __builtin_shufflevector(__s1_866, __s1_866, 1, 0); \
67981 uint32x2_t __rev2_866; __rev2_866 = __builtin_shufflevector(__s2_866, __s2_866, 1, 0); \
67982 __ret_866 = __rev0_866 - __noswap_vmull_u32(__rev1_866, __noswap_splat_lane_u32(__rev2_866, __p3_866)); \
67983 __ret_866 = __builtin_shufflevector(__ret_866, __ret_866, 1, 0); \
67984 __ret_866; \
67812#define vmlsl_lane_u32(__p0_862, __p1_862, __p2_862, __p3_862) __extension__ ({ \
67813 uint64x2_t __ret_862; \
67814 uint64x2_t __s0_862 = __p0_862; \
67815 uint32x2_t __s1_862 = __p1_862; \
67816 uint32x2_t __s2_862 = __p2_862; \
67817 uint64x2_t __rev0_862; __rev0_862 = __builtin_shufflevector(__s0_862, __s0_862, 1, 0); \
67818 uint32x2_t __rev1_862; __rev1_862 = __builtin_shufflevector(__s1_862, __s1_862, 1, 0); \
67819 uint32x2_t __rev2_862; __rev2_862 = __builtin_shufflevector(__s2_862, __s2_862, 1, 0); \
67820 __ret_862 = __rev0_862 - __noswap_vmull_u32(__rev1_862, __noswap_splat_lane_u32(__rev2_862, __p3_862)); \
67821 __ret_862 = __builtin_shufflevector(__ret_862, __ret_862, 1, 0); \
67822 __ret_862; \
6798567823})
6798667824#endif
6798767825
6798867826#ifdef __LITTLE_ENDIAN__
67989#define vmlsl_lane_u16(__p0_867, __p1_867, __p2_867, __p3_867) __extension__ ({ \
67990 uint32x4_t __ret_867; \
67991 uint32x4_t __s0_867 = __p0_867; \
67992 uint16x4_t __s1_867 = __p1_867; \
67993 uint16x4_t __s2_867 = __p2_867; \
67994 __ret_867 = __s0_867 - vmull_u16(__s1_867, splat_lane_u16(__s2_867, __p3_867)); \
67995 __ret_867; \
67827#define vmlsl_lane_u16(__p0_863, __p1_863, __p2_863, __p3_863) __extension__ ({ \
67828 uint32x4_t __ret_863; \
67829 uint32x4_t __s0_863 = __p0_863; \
67830 uint16x4_t __s1_863 = __p1_863; \
67831 uint16x4_t __s2_863 = __p2_863; \
67832 __ret_863 = __s0_863 - vmull_u16(__s1_863, splat_lane_u16(__s2_863, __p3_863)); \
67833 __ret_863; \
6799667834})
6799767835#else
67998#define vmlsl_lane_u16(__p0_868, __p1_868, __p2_868, __p3_868) __extension__ ({ \
67999 uint32x4_t __ret_868; \
68000 uint32x4_t __s0_868 = __p0_868; \
68001 uint16x4_t __s1_868 = __p1_868; \
68002 uint16x4_t __s2_868 = __p2_868; \
68003 uint32x4_t __rev0_868; __rev0_868 = __builtin_shufflevector(__s0_868, __s0_868, 3, 2, 1, 0); \
68004 uint16x4_t __rev1_868; __rev1_868 = __builtin_shufflevector(__s1_868, __s1_868, 3, 2, 1, 0); \
68005 uint16x4_t __rev2_868; __rev2_868 = __builtin_shufflevector(__s2_868, __s2_868, 3, 2, 1, 0); \
68006 __ret_868 = __rev0_868 - __noswap_vmull_u16(__rev1_868, __noswap_splat_lane_u16(__rev2_868, __p3_868)); \
68007 __ret_868 = __builtin_shufflevector(__ret_868, __ret_868, 3, 2, 1, 0); \
68008 __ret_868; \
67836#define vmlsl_lane_u16(__p0_864, __p1_864, __p2_864, __p3_864) __extension__ ({ \
67837 uint32x4_t __ret_864; \
67838 uint32x4_t __s0_864 = __p0_864; \
67839 uint16x4_t __s1_864 = __p1_864; \
67840 uint16x4_t __s2_864 = __p2_864; \
67841 uint32x4_t __rev0_864; __rev0_864 = __builtin_shufflevector(__s0_864, __s0_864, 3, 2, 1, 0); \
67842 uint16x4_t __rev1_864; __rev1_864 = __builtin_shufflevector(__s1_864, __s1_864, 3, 2, 1, 0); \
67843 uint16x4_t __rev2_864; __rev2_864 = __builtin_shufflevector(__s2_864, __s2_864, 3, 2, 1, 0); \
67844 __ret_864 = __rev0_864 - __noswap_vmull_u16(__rev1_864, __noswap_splat_lane_u16(__rev2_864, __p3_864)); \
67845 __ret_864 = __builtin_shufflevector(__ret_864, __ret_864, 3, 2, 1, 0); \
67846 __ret_864; \
6800967847})
6801067848#endif
6801167849
6801267850#ifdef __LITTLE_ENDIAN__
68013#define vmlsl_lane_s32(__p0_869, __p1_869, __p2_869, __p3_869) __extension__ ({ \
68014 int64x2_t __ret_869; \
68015 int64x2_t __s0_869 = __p0_869; \
68016 int32x2_t __s1_869 = __p1_869; \
68017 int32x2_t __s2_869 = __p2_869; \
68018 __ret_869 = __s0_869 - vmull_s32(__s1_869, splat_lane_s32(__s2_869, __p3_869)); \
68019 __ret_869; \
67851#define vmlsl_lane_s32(__p0_865, __p1_865, __p2_865, __p3_865) __extension__ ({ \
67852 int64x2_t __ret_865; \
67853 int64x2_t __s0_865 = __p0_865; \
67854 int32x2_t __s1_865 = __p1_865; \
67855 int32x2_t __s2_865 = __p2_865; \
67856 __ret_865 = __s0_865 - vmull_s32(__s1_865, splat_lane_s32(__s2_865, __p3_865)); \
67857 __ret_865; \
6802067858})
6802167859#else
68022#define vmlsl_lane_s32(__p0_870, __p1_870, __p2_870, __p3_870) __extension__ ({ \
68023 int64x2_t __ret_870; \
68024 int64x2_t __s0_870 = __p0_870; \
68025 int32x2_t __s1_870 = __p1_870; \
68026 int32x2_t __s2_870 = __p2_870; \
68027 int64x2_t __rev0_870; __rev0_870 = __builtin_shufflevector(__s0_870, __s0_870, 1, 0); \
68028 int32x2_t __rev1_870; __rev1_870 = __builtin_shufflevector(__s1_870, __s1_870, 1, 0); \
68029 int32x2_t __rev2_870; __rev2_870 = __builtin_shufflevector(__s2_870, __s2_870, 1, 0); \
68030 __ret_870 = __rev0_870 - __noswap_vmull_s32(__rev1_870, __noswap_splat_lane_s32(__rev2_870, __p3_870)); \
68031 __ret_870 = __builtin_shufflevector(__ret_870, __ret_870, 1, 0); \
68032 __ret_870; \
67860#define vmlsl_lane_s32(__p0_866, __p1_866, __p2_866, __p3_866) __extension__ ({ \
67861 int64x2_t __ret_866; \
67862 int64x2_t __s0_866 = __p0_866; \
67863 int32x2_t __s1_866 = __p1_866; \
67864 int32x2_t __s2_866 = __p2_866; \
67865 int64x2_t __rev0_866; __rev0_866 = __builtin_shufflevector(__s0_866, __s0_866, 1, 0); \
67866 int32x2_t __rev1_866; __rev1_866 = __builtin_shufflevector(__s1_866, __s1_866, 1, 0); \
67867 int32x2_t __rev2_866; __rev2_866 = __builtin_shufflevector(__s2_866, __s2_866, 1, 0); \
67868 __ret_866 = __rev0_866 - __noswap_vmull_s32(__rev1_866, __noswap_splat_lane_s32(__rev2_866, __p3_866)); \
67869 __ret_866 = __builtin_shufflevector(__ret_866, __ret_866, 1, 0); \
67870 __ret_866; \
6803367871})
6803467872#endif
6803567873
6803667874#ifdef __LITTLE_ENDIAN__
68037#define vmlsl_lane_s16(__p0_871, __p1_871, __p2_871, __p3_871) __extension__ ({ \
68038 int32x4_t __ret_871; \
68039 int32x4_t __s0_871 = __p0_871; \
68040 int16x4_t __s1_871 = __p1_871; \
68041 int16x4_t __s2_871 = __p2_871; \
68042 __ret_871 = __s0_871 - vmull_s16(__s1_871, splat_lane_s16(__s2_871, __p3_871)); \
68043 __ret_871; \
67875#define vmlsl_lane_s16(__p0_867, __p1_867, __p2_867, __p3_867) __extension__ ({ \
67876 int32x4_t __ret_867; \
67877 int32x4_t __s0_867 = __p0_867; \
67878 int16x4_t __s1_867 = __p1_867; \
67879 int16x4_t __s2_867 = __p2_867; \
67880 __ret_867 = __s0_867 - vmull_s16(__s1_867, splat_lane_s16(__s2_867, __p3_867)); \
67881 __ret_867; \
6804467882})
6804567883#else
68046#define vmlsl_lane_s16(__p0_872, __p1_872, __p2_872, __p3_872) __extension__ ({ \
68047 int32x4_t __ret_872; \
68048 int32x4_t __s0_872 = __p0_872; \
68049 int16x4_t __s1_872 = __p1_872; \
68050 int16x4_t __s2_872 = __p2_872; \
68051 int32x4_t __rev0_872; __rev0_872 = __builtin_shufflevector(__s0_872, __s0_872, 3, 2, 1, 0); \
68052 int16x4_t __rev1_872; __rev1_872 = __builtin_shufflevector(__s1_872, __s1_872, 3, 2, 1, 0); \
68053 int16x4_t __rev2_872; __rev2_872 = __builtin_shufflevector(__s2_872, __s2_872, 3, 2, 1, 0); \
68054 __ret_872 = __rev0_872 - __noswap_vmull_s16(__rev1_872, __noswap_splat_lane_s16(__rev2_872, __p3_872)); \
68055 __ret_872 = __builtin_shufflevector(__ret_872, __ret_872, 3, 2, 1, 0); \
68056 __ret_872; \
67884#define vmlsl_lane_s16(__p0_868, __p1_868, __p2_868, __p3_868) __extension__ ({ \
67885 int32x4_t __ret_868; \
67886 int32x4_t __s0_868 = __p0_868; \
67887 int16x4_t __s1_868 = __p1_868; \
67888 int16x4_t __s2_868 = __p2_868; \
67889 int32x4_t __rev0_868; __rev0_868 = __builtin_shufflevector(__s0_868, __s0_868, 3, 2, 1, 0); \
67890 int16x4_t __rev1_868; __rev1_868 = __builtin_shufflevector(__s1_868, __s1_868, 3, 2, 1, 0); \
67891 int16x4_t __rev2_868; __rev2_868 = __builtin_shufflevector(__s2_868, __s2_868, 3, 2, 1, 0); \
67892 __ret_868 = __rev0_868 - __noswap_vmull_s16(__rev1_868, __noswap_splat_lane_s16(__rev2_868, __p3_868)); \
67893 __ret_868 = __builtin_shufflevector(__ret_868, __ret_868, 3, 2, 1, 0); \
67894 __ret_868; \
6805767895})
6805867896#endif
6805967897
......@@ -68146,69 +67984,116 @@ __ai int32x4_t __noswap_vmlsl_n_s16(int32x4_t __p0, int16x4_t __p1, int16_t __p2
6814667984#endif
6814767985
6814867986#ifdef __LITTLE_ENDIAN__
68149#define vset_lane_f16(__p0_873, __p1_873, __p2_873) __extension__ ({ \
68150 float16x4_t __ret_873; \
68151 float16_t __s0_873 = __p0_873; \
68152 float16x4_t __s1_873 = __p1_873; \
68153float16_t __reint_873 = __s0_873; \
68154float16x4_t __reint1_873 = __s1_873; \
68155int16x4_t __reint2_873 = vset_lane_s16(*(int16_t *) &__reint_873, *(int16x4_t *) &__reint1_873, __p2_873); \
68156 __ret_873 = *(float16x4_t *) &__reint2_873; \
67987#define vset_lane_f16(__p0_869, __p1_869, __p2_869) __extension__ ({ \
67988 float16x4_t __ret_869; \
67989 float16_t __s0_869 = __p0_869; \
67990 float16x4_t __s1_869 = __p1_869; \
67991float16_t __reint_869 = __s0_869; \
67992float16x4_t __reint1_869 = __s1_869; \
67993int16x4_t __reint2_869 = vset_lane_s16(*(int16_t *) &__reint_869, *(int16x4_t *) &__reint1_869, __p2_869); \
67994 __ret_869 = *(float16x4_t *) &__reint2_869; \
67995 __ret_869; \
67996})
67997#else
67998#define vset_lane_f16(__p0_870, __p1_870, __p2_870) __extension__ ({ \
67999 float16x4_t __ret_870; \
68000 float16_t __s0_870 = __p0_870; \
68001 float16x4_t __s1_870 = __p1_870; \
68002 float16x4_t __rev1_870; __rev1_870 = __builtin_shufflevector(__s1_870, __s1_870, 3, 2, 1, 0); \
68003float16_t __reint_870 = __s0_870; \
68004float16x4_t __reint1_870 = __rev1_870; \
68005int16x4_t __reint2_870 = __noswap_vset_lane_s16(*(int16_t *) &__reint_870, *(int16x4_t *) &__reint1_870, __p2_870); \
68006 __ret_870 = *(float16x4_t *) &__reint2_870; \
68007 __ret_870 = __builtin_shufflevector(__ret_870, __ret_870, 3, 2, 1, 0); \
68008 __ret_870; \
68009})
68010#endif
68011
68012#ifdef __LITTLE_ENDIAN__
68013#define vsetq_lane_f16(__p0_871, __p1_871, __p2_871) __extension__ ({ \
68014 float16x8_t __ret_871; \
68015 float16_t __s0_871 = __p0_871; \
68016 float16x8_t __s1_871 = __p1_871; \
68017float16_t __reint_871 = __s0_871; \
68018float16x8_t __reint1_871 = __s1_871; \
68019int16x8_t __reint2_871 = vsetq_lane_s16(*(int16_t *) &__reint_871, *(int16x8_t *) &__reint1_871, __p2_871); \
68020 __ret_871 = *(float16x8_t *) &__reint2_871; \
68021 __ret_871; \
68022})
68023#else
68024#define vsetq_lane_f16(__p0_872, __p1_872, __p2_872) __extension__ ({ \
68025 float16x8_t __ret_872; \
68026 float16_t __s0_872 = __p0_872; \
68027 float16x8_t __s1_872 = __p1_872; \
68028 float16x8_t __rev1_872; __rev1_872 = __builtin_shufflevector(__s1_872, __s1_872, 7, 6, 5, 4, 3, 2, 1, 0); \
68029float16_t __reint_872 = __s0_872; \
68030float16x8_t __reint1_872 = __rev1_872; \
68031int16x8_t __reint2_872 = __noswap_vsetq_lane_s16(*(int16_t *) &__reint_872, *(int16x8_t *) &__reint1_872, __p2_872); \
68032 __ret_872 = *(float16x8_t *) &__reint2_872; \
68033 __ret_872 = __builtin_shufflevector(__ret_872, __ret_872, 7, 6, 5, 4, 3, 2, 1, 0); \
68034 __ret_872; \
68035})
68036#endif
68037
68038#ifdef __LITTLE_ENDIAN__
68039#define vbfmlalbq_lane_f32(__p0_873, __p1_873, __p2_873, __p3_873) __extension__ ({ \
68040 float32x4_t __ret_873; \
68041 float32x4_t __s0_873 = __p0_873; \
68042 bfloat16x8_t __s1_873 = __p1_873; \
68043 bfloat16x4_t __s2_873 = __p2_873; \
68044 __ret_873 = vbfmlalbq_f32(__s0_873, __s1_873, (bfloat16x8_t) {vget_lane_bf16(__s2_873, __p3_873), vget_lane_bf16(__s2_873, __p3_873), vget_lane_bf16(__s2_873, __p3_873), vget_lane_bf16(__s2_873, __p3_873), vget_lane_bf16(__s2_873, __p3_873), vget_lane_bf16(__s2_873, __p3_873), vget_lane_bf16(__s2_873, __p3_873), vget_lane_bf16(__s2_873, __p3_873)}); \
6815768045 __ret_873; \
6815868046})
6815968047#else
68160#define vset_lane_f16(__p0_874, __p1_874, __p2_874) __extension__ ({ \
68161 float16x4_t __ret_874; \
68162 float16_t __s0_874 = __p0_874; \
68163 float16x4_t __s1_874 = __p1_874; \
68164 float16x4_t __rev1_874; __rev1_874 = __builtin_shufflevector(__s1_874, __s1_874, 3, 2, 1, 0); \
68165float16_t __reint_874 = __s0_874; \
68166float16x4_t __reint1_874 = __rev1_874; \
68167int16x4_t __reint2_874 = __noswap_vset_lane_s16(*(int16_t *) &__reint_874, *(int16x4_t *) &__reint1_874, __p2_874); \
68168 __ret_874 = *(float16x4_t *) &__reint2_874; \
68048#define vbfmlalbq_lane_f32(__p0_874, __p1_874, __p2_874, __p3_874) __extension__ ({ \
68049 float32x4_t __ret_874; \
68050 float32x4_t __s0_874 = __p0_874; \
68051 bfloat16x8_t __s1_874 = __p1_874; \
68052 bfloat16x4_t __s2_874 = __p2_874; \
68053 float32x4_t __rev0_874; __rev0_874 = __builtin_shufflevector(__s0_874, __s0_874, 3, 2, 1, 0); \
68054 bfloat16x8_t __rev1_874; __rev1_874 = __builtin_shufflevector(__s1_874, __s1_874, 7, 6, 5, 4, 3, 2, 1, 0); \
68055 bfloat16x4_t __rev2_874; __rev2_874 = __builtin_shufflevector(__s2_874, __s2_874, 3, 2, 1, 0); \
68056 __ret_874 = __noswap_vbfmlalbq_f32(__rev0_874, __rev1_874, (bfloat16x8_t) {__noswap_vget_lane_bf16(__rev2_874, __p3_874), __noswap_vget_lane_bf16(__rev2_874, __p3_874), __noswap_vget_lane_bf16(__rev2_874, __p3_874), __noswap_vget_lane_bf16(__rev2_874, __p3_874), __noswap_vget_lane_bf16(__rev2_874, __p3_874), __noswap_vget_lane_bf16(__rev2_874, __p3_874), __noswap_vget_lane_bf16(__rev2_874, __p3_874), __noswap_vget_lane_bf16(__rev2_874, __p3_874)}); \
6816968057 __ret_874 = __builtin_shufflevector(__ret_874, __ret_874, 3, 2, 1, 0); \
6817068058 __ret_874; \
6817168059})
6817268060#endif
6817368061
6817468062#ifdef __LITTLE_ENDIAN__
68175#define vsetq_lane_f16(__p0_875, __p1_875, __p2_875) __extension__ ({ \
68176 float16x8_t __ret_875; \
68177 float16_t __s0_875 = __p0_875; \
68178 float16x8_t __s1_875 = __p1_875; \
68179float16_t __reint_875 = __s0_875; \
68180float16x8_t __reint1_875 = __s1_875; \
68181int16x8_t __reint2_875 = vsetq_lane_s16(*(int16_t *) &__reint_875, *(int16x8_t *) &__reint1_875, __p2_875); \
68182 __ret_875 = *(float16x8_t *) &__reint2_875; \
68063#define vbfmlalbq_laneq_f32(__p0_875, __p1_875, __p2_875, __p3_875) __extension__ ({ \
68064 float32x4_t __ret_875; \
68065 float32x4_t __s0_875 = __p0_875; \
68066 bfloat16x8_t __s1_875 = __p1_875; \
68067 bfloat16x8_t __s2_875 = __p2_875; \
68068 __ret_875 = vbfmlalbq_f32(__s0_875, __s1_875, (bfloat16x8_t) {vgetq_lane_bf16(__s2_875, __p3_875), vgetq_lane_bf16(__s2_875, __p3_875), vgetq_lane_bf16(__s2_875, __p3_875), vgetq_lane_bf16(__s2_875, __p3_875), vgetq_lane_bf16(__s2_875, __p3_875), vgetq_lane_bf16(__s2_875, __p3_875), vgetq_lane_bf16(__s2_875, __p3_875), vgetq_lane_bf16(__s2_875, __p3_875)}); \
6818368069 __ret_875; \
6818468070})
6818568071#else
68186#define vsetq_lane_f16(__p0_876, __p1_876, __p2_876) __extension__ ({ \
68187 float16x8_t __ret_876; \
68188 float16_t __s0_876 = __p0_876; \
68189 float16x8_t __s1_876 = __p1_876; \
68190 float16x8_t __rev1_876; __rev1_876 = __builtin_shufflevector(__s1_876, __s1_876, 7, 6, 5, 4, 3, 2, 1, 0); \
68191float16_t __reint_876 = __s0_876; \
68192float16x8_t __reint1_876 = __rev1_876; \
68193int16x8_t __reint2_876 = __noswap_vsetq_lane_s16(*(int16_t *) &__reint_876, *(int16x8_t *) &__reint1_876, __p2_876); \
68194 __ret_876 = *(float16x8_t *) &__reint2_876; \
68195 __ret_876 = __builtin_shufflevector(__ret_876, __ret_876, 7, 6, 5, 4, 3, 2, 1, 0); \
68072#define vbfmlalbq_laneq_f32(__p0_876, __p1_876, __p2_876, __p3_876) __extension__ ({ \
68073 float32x4_t __ret_876; \
68074 float32x4_t __s0_876 = __p0_876; \
68075 bfloat16x8_t __s1_876 = __p1_876; \
68076 bfloat16x8_t __s2_876 = __p2_876; \
68077 float32x4_t __rev0_876; __rev0_876 = __builtin_shufflevector(__s0_876, __s0_876, 3, 2, 1, 0); \
68078 bfloat16x8_t __rev1_876; __rev1_876 = __builtin_shufflevector(__s1_876, __s1_876, 7, 6, 5, 4, 3, 2, 1, 0); \
68079 bfloat16x8_t __rev2_876; __rev2_876 = __builtin_shufflevector(__s2_876, __s2_876, 7, 6, 5, 4, 3, 2, 1, 0); \
68080 __ret_876 = __noswap_vbfmlalbq_f32(__rev0_876, __rev1_876, (bfloat16x8_t) {__noswap_vgetq_lane_bf16(__rev2_876, __p3_876), __noswap_vgetq_lane_bf16(__rev2_876, __p3_876), __noswap_vgetq_lane_bf16(__rev2_876, __p3_876), __noswap_vgetq_lane_bf16(__rev2_876, __p3_876), __noswap_vgetq_lane_bf16(__rev2_876, __p3_876), __noswap_vgetq_lane_bf16(__rev2_876, __p3_876), __noswap_vgetq_lane_bf16(__rev2_876, __p3_876), __noswap_vgetq_lane_bf16(__rev2_876, __p3_876)}); \
68081 __ret_876 = __builtin_shufflevector(__ret_876, __ret_876, 3, 2, 1, 0); \
6819668082 __ret_876; \
6819768083})
6819868084#endif
6819968085
68200#if defined(__ARM_FEATURE_BF16_VECTOR_ARITHMETIC)
6820168086#ifdef __LITTLE_ENDIAN__
68202#define vbfmlalbq_lane_f32(__p0_877, __p1_877, __p2_877, __p3_877) __extension__ ({ \
68087#define vbfmlaltq_lane_f32(__p0_877, __p1_877, __p2_877, __p3_877) __extension__ ({ \
6820368088 float32x4_t __ret_877; \
6820468089 float32x4_t __s0_877 = __p0_877; \
6820568090 bfloat16x8_t __s1_877 = __p1_877; \
6820668091 bfloat16x4_t __s2_877 = __p2_877; \
68207 __ret_877 = vbfmlalbq_f32(__s0_877, __s1_877, (bfloat16x8_t) {vget_lane_bf16(__s2_877, __p3_877), vget_lane_bf16(__s2_877, __p3_877), vget_lane_bf16(__s2_877, __p3_877), vget_lane_bf16(__s2_877, __p3_877), vget_lane_bf16(__s2_877, __p3_877), vget_lane_bf16(__s2_877, __p3_877), vget_lane_bf16(__s2_877, __p3_877), vget_lane_bf16(__s2_877, __p3_877)}); \
68092 __ret_877 = vbfmlaltq_f32(__s0_877, __s1_877, (bfloat16x8_t) {vget_lane_bf16(__s2_877, __p3_877), vget_lane_bf16(__s2_877, __p3_877), vget_lane_bf16(__s2_877, __p3_877), vget_lane_bf16(__s2_877, __p3_877), vget_lane_bf16(__s2_877, __p3_877), vget_lane_bf16(__s2_877, __p3_877), vget_lane_bf16(__s2_877, __p3_877), vget_lane_bf16(__s2_877, __p3_877)}); \
6820868093 __ret_877; \
6820968094})
6821068095#else
68211#define vbfmlalbq_lane_f32(__p0_878, __p1_878, __p2_878, __p3_878) __extension__ ({ \
68096#define vbfmlaltq_lane_f32(__p0_878, __p1_878, __p2_878, __p3_878) __extension__ ({ \
6821268097 float32x4_t __ret_878; \
6821368098 float32x4_t __s0_878 = __p0_878; \
6821468099 bfloat16x8_t __s1_878 = __p1_878; \
......@@ -68216,23 +68101,23 @@ int16x8_t __reint2_876 = __noswap_vsetq_lane_s16(*(int16_t *) &__reint_876, *(in
6821668101 float32x4_t __rev0_878; __rev0_878 = __builtin_shufflevector(__s0_878, __s0_878, 3, 2, 1, 0); \
6821768102 bfloat16x8_t __rev1_878; __rev1_878 = __builtin_shufflevector(__s1_878, __s1_878, 7, 6, 5, 4, 3, 2, 1, 0); \
6821868103 bfloat16x4_t __rev2_878; __rev2_878 = __builtin_shufflevector(__s2_878, __s2_878, 3, 2, 1, 0); \
68219 __ret_878 = __noswap_vbfmlalbq_f32(__rev0_878, __rev1_878, (bfloat16x8_t) {__noswap_vget_lane_bf16(__rev2_878, __p3_878), __noswap_vget_lane_bf16(__rev2_878, __p3_878), __noswap_vget_lane_bf16(__rev2_878, __p3_878), __noswap_vget_lane_bf16(__rev2_878, __p3_878), __noswap_vget_lane_bf16(__rev2_878, __p3_878), __noswap_vget_lane_bf16(__rev2_878, __p3_878), __noswap_vget_lane_bf16(__rev2_878, __p3_878), __noswap_vget_lane_bf16(__rev2_878, __p3_878)}); \
68104 __ret_878 = __noswap_vbfmlaltq_f32(__rev0_878, __rev1_878, (bfloat16x8_t) {__noswap_vget_lane_bf16(__rev2_878, __p3_878), __noswap_vget_lane_bf16(__rev2_878, __p3_878), __noswap_vget_lane_bf16(__rev2_878, __p3_878), __noswap_vget_lane_bf16(__rev2_878, __p3_878), __noswap_vget_lane_bf16(__rev2_878, __p3_878), __noswap_vget_lane_bf16(__rev2_878, __p3_878), __noswap_vget_lane_bf16(__rev2_878, __p3_878), __noswap_vget_lane_bf16(__rev2_878, __p3_878)}); \
6822068105 __ret_878 = __builtin_shufflevector(__ret_878, __ret_878, 3, 2, 1, 0); \
6822168106 __ret_878; \
6822268107})
6822368108#endif
6822468109
6822568110#ifdef __LITTLE_ENDIAN__
68226#define vbfmlalbq_laneq_f32(__p0_879, __p1_879, __p2_879, __p3_879) __extension__ ({ \
68111#define vbfmlaltq_laneq_f32(__p0_879, __p1_879, __p2_879, __p3_879) __extension__ ({ \
6822768112 float32x4_t __ret_879; \
6822868113 float32x4_t __s0_879 = __p0_879; \
6822968114 bfloat16x8_t __s1_879 = __p1_879; \
6823068115 bfloat16x8_t __s2_879 = __p2_879; \
68231 __ret_879 = vbfmlalbq_f32(__s0_879, __s1_879, (bfloat16x8_t) {vgetq_lane_bf16(__s2_879, __p3_879), vgetq_lane_bf16(__s2_879, __p3_879), vgetq_lane_bf16(__s2_879, __p3_879), vgetq_lane_bf16(__s2_879, __p3_879), vgetq_lane_bf16(__s2_879, __p3_879), vgetq_lane_bf16(__s2_879, __p3_879), vgetq_lane_bf16(__s2_879, __p3_879), vgetq_lane_bf16(__s2_879, __p3_879)}); \
68116 __ret_879 = vbfmlaltq_f32(__s0_879, __s1_879, (bfloat16x8_t) {vgetq_lane_bf16(__s2_879, __p3_879), vgetq_lane_bf16(__s2_879, __p3_879), vgetq_lane_bf16(__s2_879, __p3_879), vgetq_lane_bf16(__s2_879, __p3_879), vgetq_lane_bf16(__s2_879, __p3_879), vgetq_lane_bf16(__s2_879, __p3_879), vgetq_lane_bf16(__s2_879, __p3_879), vgetq_lane_bf16(__s2_879, __p3_879)}); \
6823268117 __ret_879; \
6823368118})
6823468119#else
68235#define vbfmlalbq_laneq_f32(__p0_880, __p1_880, __p2_880, __p3_880) __extension__ ({ \
68120#define vbfmlaltq_laneq_f32(__p0_880, __p1_880, __p2_880, __p3_880) __extension__ ({ \
6823668121 float32x4_t __ret_880; \
6823768122 float32x4_t __s0_880 = __p0_880; \
6823868123 bfloat16x8_t __s1_880 = __p1_880; \
......@@ -68240,68 +68125,20 @@ int16x8_t __reint2_876 = __noswap_vsetq_lane_s16(*(int16_t *) &__reint_876, *(in
6824068125 float32x4_t __rev0_880; __rev0_880 = __builtin_shufflevector(__s0_880, __s0_880, 3, 2, 1, 0); \
6824168126 bfloat16x8_t __rev1_880; __rev1_880 = __builtin_shufflevector(__s1_880, __s1_880, 7, 6, 5, 4, 3, 2, 1, 0); \
6824268127 bfloat16x8_t __rev2_880; __rev2_880 = __builtin_shufflevector(__s2_880, __s2_880, 7, 6, 5, 4, 3, 2, 1, 0); \
68243 __ret_880 = __noswap_vbfmlalbq_f32(__rev0_880, __rev1_880, (bfloat16x8_t) {__noswap_vgetq_lane_bf16(__rev2_880, __p3_880), __noswap_vgetq_lane_bf16(__rev2_880, __p3_880), __noswap_vgetq_lane_bf16(__rev2_880, __p3_880), __noswap_vgetq_lane_bf16(__rev2_880, __p3_880), __noswap_vgetq_lane_bf16(__rev2_880, __p3_880), __noswap_vgetq_lane_bf16(__rev2_880, __p3_880), __noswap_vgetq_lane_bf16(__rev2_880, __p3_880), __noswap_vgetq_lane_bf16(__rev2_880, __p3_880)}); \
68128 __ret_880 = __noswap_vbfmlaltq_f32(__rev0_880, __rev1_880, (bfloat16x8_t) {__noswap_vgetq_lane_bf16(__rev2_880, __p3_880), __noswap_vgetq_lane_bf16(__rev2_880, __p3_880), __noswap_vgetq_lane_bf16(__rev2_880, __p3_880), __noswap_vgetq_lane_bf16(__rev2_880, __p3_880), __noswap_vgetq_lane_bf16(__rev2_880, __p3_880), __noswap_vgetq_lane_bf16(__rev2_880, __p3_880), __noswap_vgetq_lane_bf16(__rev2_880, __p3_880), __noswap_vgetq_lane_bf16(__rev2_880, __p3_880)}); \
6824468129 __ret_880 = __builtin_shufflevector(__ret_880, __ret_880, 3, 2, 1, 0); \
6824568130 __ret_880; \
6824668131})
6824768132#endif
6824868133
6824968134#ifdef __LITTLE_ENDIAN__
68250#define vbfmlaltq_lane_f32(__p0_881, __p1_881, __p2_881, __p3_881) __extension__ ({ \
68251 float32x4_t __ret_881; \
68252 float32x4_t __s0_881 = __p0_881; \
68253 bfloat16x8_t __s1_881 = __p1_881; \
68254 bfloat16x4_t __s2_881 = __p2_881; \
68255 __ret_881 = vbfmlaltq_f32(__s0_881, __s1_881, (bfloat16x8_t) {vget_lane_bf16(__s2_881, __p3_881), vget_lane_bf16(__s2_881, __p3_881), vget_lane_bf16(__s2_881, __p3_881), vget_lane_bf16(__s2_881, __p3_881), vget_lane_bf16(__s2_881, __p3_881), vget_lane_bf16(__s2_881, __p3_881), vget_lane_bf16(__s2_881, __p3_881), vget_lane_bf16(__s2_881, __p3_881)}); \
68256 __ret_881; \
68257})
68258#else
68259#define vbfmlaltq_lane_f32(__p0_882, __p1_882, __p2_882, __p3_882) __extension__ ({ \
68260 float32x4_t __ret_882; \
68261 float32x4_t __s0_882 = __p0_882; \
68262 bfloat16x8_t __s1_882 = __p1_882; \
68263 bfloat16x4_t __s2_882 = __p2_882; \
68264 float32x4_t __rev0_882; __rev0_882 = __builtin_shufflevector(__s0_882, __s0_882, 3, 2, 1, 0); \
68265 bfloat16x8_t __rev1_882; __rev1_882 = __builtin_shufflevector(__s1_882, __s1_882, 7, 6, 5, 4, 3, 2, 1, 0); \
68266 bfloat16x4_t __rev2_882; __rev2_882 = __builtin_shufflevector(__s2_882, __s2_882, 3, 2, 1, 0); \
68267 __ret_882 = __noswap_vbfmlaltq_f32(__rev0_882, __rev1_882, (bfloat16x8_t) {__noswap_vget_lane_bf16(__rev2_882, __p3_882), __noswap_vget_lane_bf16(__rev2_882, __p3_882), __noswap_vget_lane_bf16(__rev2_882, __p3_882), __noswap_vget_lane_bf16(__rev2_882, __p3_882), __noswap_vget_lane_bf16(__rev2_882, __p3_882), __noswap_vget_lane_bf16(__rev2_882, __p3_882), __noswap_vget_lane_bf16(__rev2_882, __p3_882), __noswap_vget_lane_bf16(__rev2_882, __p3_882)}); \
68268 __ret_882 = __builtin_shufflevector(__ret_882, __ret_882, 3, 2, 1, 0); \
68269 __ret_882; \
68270})
68271#endif
68272
68273#ifdef __LITTLE_ENDIAN__
68274#define vbfmlaltq_laneq_f32(__p0_883, __p1_883, __p2_883, __p3_883) __extension__ ({ \
68275 float32x4_t __ret_883; \
68276 float32x4_t __s0_883 = __p0_883; \
68277 bfloat16x8_t __s1_883 = __p1_883; \
68278 bfloat16x8_t __s2_883 = __p2_883; \
68279 __ret_883 = vbfmlaltq_f32(__s0_883, __s1_883, (bfloat16x8_t) {vgetq_lane_bf16(__s2_883, __p3_883), vgetq_lane_bf16(__s2_883, __p3_883), vgetq_lane_bf16(__s2_883, __p3_883), vgetq_lane_bf16(__s2_883, __p3_883), vgetq_lane_bf16(__s2_883, __p3_883), vgetq_lane_bf16(__s2_883, __p3_883), vgetq_lane_bf16(__s2_883, __p3_883), vgetq_lane_bf16(__s2_883, __p3_883)}); \
68280 __ret_883; \
68281})
68282#else
68283#define vbfmlaltq_laneq_f32(__p0_884, __p1_884, __p2_884, __p3_884) __extension__ ({ \
68284 float32x4_t __ret_884; \
68285 float32x4_t __s0_884 = __p0_884; \
68286 bfloat16x8_t __s1_884 = __p1_884; \
68287 bfloat16x8_t __s2_884 = __p2_884; \
68288 float32x4_t __rev0_884; __rev0_884 = __builtin_shufflevector(__s0_884, __s0_884, 3, 2, 1, 0); \
68289 bfloat16x8_t __rev1_884; __rev1_884 = __builtin_shufflevector(__s1_884, __s1_884, 7, 6, 5, 4, 3, 2, 1, 0); \
68290 bfloat16x8_t __rev2_884; __rev2_884 = __builtin_shufflevector(__s2_884, __s2_884, 7, 6, 5, 4, 3, 2, 1, 0); \
68291 __ret_884 = __noswap_vbfmlaltq_f32(__rev0_884, __rev1_884, (bfloat16x8_t) {__noswap_vgetq_lane_bf16(__rev2_884, __p3_884), __noswap_vgetq_lane_bf16(__rev2_884, __p3_884), __noswap_vgetq_lane_bf16(__rev2_884, __p3_884), __noswap_vgetq_lane_bf16(__rev2_884, __p3_884), __noswap_vgetq_lane_bf16(__rev2_884, __p3_884), __noswap_vgetq_lane_bf16(__rev2_884, __p3_884), __noswap_vgetq_lane_bf16(__rev2_884, __p3_884), __noswap_vgetq_lane_bf16(__rev2_884, __p3_884)}); \
68292 __ret_884 = __builtin_shufflevector(__ret_884, __ret_884, 3, 2, 1, 0); \
68293 __ret_884; \
68294})
68295#endif
68296
68297#ifdef __LITTLE_ENDIAN__
68298__ai float32x4_t vcvtq_high_f32_bf16(bfloat16x8_t __p0) {
68135__ai __attribute__((target("bf16"))) float32x4_t vcvtq_high_f32_bf16(bfloat16x8_t __p0) {
6829968136 float32x4_t __ret;
6830068137 __ret = vcvt_f32_bf16(vget_high_bf16(__p0));
6830168138 return __ret;
6830268139}
6830368140#else
68304__ai float32x4_t vcvtq_high_f32_bf16(bfloat16x8_t __p0) {
68141__ai __attribute__((target("bf16"))) float32x4_t vcvtq_high_f32_bf16(bfloat16x8_t __p0) {
6830568142 float32x4_t __ret;
6830668143 bfloat16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
6830768144 __ret = __noswap_vcvt_f32_bf16(__noswap_vget_high_bf16(__rev0));
......@@ -68311,13 +68148,13 @@ __ai float32x4_t vcvtq_high_f32_bf16(bfloat16x8_t __p0) {
6831168148#endif
6831268149
6831368150#ifdef __LITTLE_ENDIAN__
68314__ai float32x4_t vcvtq_low_f32_bf16(bfloat16x8_t __p0) {
68151__ai __attribute__((target("bf16"))) float32x4_t vcvtq_low_f32_bf16(bfloat16x8_t __p0) {
6831568152 float32x4_t __ret;
6831668153 __ret = vcvt_f32_bf16(vget_low_bf16(__p0));
6831768154 return __ret;
6831868155}
6831968156#else
68320__ai float32x4_t vcvtq_low_f32_bf16(bfloat16x8_t __p0) {
68157__ai __attribute__((target("bf16"))) float32x4_t vcvtq_low_f32_bf16(bfloat16x8_t __p0) {
6832168158 float32x4_t __ret;
6832268159 bfloat16x8_t __rev0; __rev0 = __builtin_shufflevector(__p0, __p0, 7, 6, 5, 4, 3, 2, 1, 0);
6832368160 __ret = __noswap_vcvt_f32_bf16(__noswap_vget_low_bf16(__rev0));
......@@ -68326,487 +68163,58 @@ __ai float32x4_t vcvtq_low_f32_bf16(bfloat16x8_t __p0) {
6832668163}
6832768164#endif
6832868165
68329#endif
68330#if defined(__ARM_FEATURE_FP16_FML) && defined(__aarch64__)
68331#ifdef __LITTLE_ENDIAN__
68332#define vfmlalq_lane_high_f16(__p0_885, __p1_885, __p2_885, __p3_885) __extension__ ({ \
68333 float32x4_t __ret_885; \
68334 float32x4_t __s0_885 = __p0_885; \
68335 float16x8_t __s1_885 = __p1_885; \
68336 float16x4_t __s2_885 = __p2_885; \
68337 __ret_885 = vfmlalq_high_f16(__s0_885, __s1_885, (float16x8_t) {vget_lane_f16(__s2_885, __p3_885), vget_lane_f16(__s2_885, __p3_885), vget_lane_f16(__s2_885, __p3_885), vget_lane_f16(__s2_885, __p3_885), vget_lane_f16(__s2_885, __p3_885), vget_lane_f16(__s2_885, __p3_885), vget_lane_f16(__s2_885, __p3_885), vget_lane_f16(__s2_885, __p3_885)}); \
68338 __ret_885; \
68339})
68340#else
68341#define vfmlalq_lane_high_f16(__p0_886, __p1_886, __p2_886, __p3_886) __extension__ ({ \
68342 float32x4_t __ret_886; \
68343 float32x4_t __s0_886 = __p0_886; \
68344 float16x8_t __s1_886 = __p1_886; \
68345 float16x4_t __s2_886 = __p2_886; \
68346 float32x4_t __rev0_886; __rev0_886 = __builtin_shufflevector(__s0_886, __s0_886, 3, 2, 1, 0); \
68347 float16x8_t __rev1_886; __rev1_886 = __builtin_shufflevector(__s1_886, __s1_886, 7, 6, 5, 4, 3, 2, 1, 0); \
68348 float16x4_t __rev2_886; __rev2_886 = __builtin_shufflevector(__s2_886, __s2_886, 3, 2, 1, 0); \
68349 __ret_886 = __noswap_vfmlalq_high_f16(__rev0_886, __rev1_886, (float16x8_t) {__noswap_vget_lane_f16(__rev2_886, __p3_886), __noswap_vget_lane_f16(__rev2_886, __p3_886), __noswap_vget_lane_f16(__rev2_886, __p3_886), __noswap_vget_lane_f16(__rev2_886, __p3_886), __noswap_vget_lane_f16(__rev2_886, __p3_886), __noswap_vget_lane_f16(__rev2_886, __p3_886), __noswap_vget_lane_f16(__rev2_886, __p3_886), __noswap_vget_lane_f16(__rev2_886, __p3_886)}); \
68350 __ret_886 = __builtin_shufflevector(__ret_886, __ret_886, 3, 2, 1, 0); \
68351 __ret_886; \
68352})
68353#endif
68354
68355#ifdef __LITTLE_ENDIAN__
68356#define vfmlal_lane_high_f16(__p0_887, __p1_887, __p2_887, __p3_887) __extension__ ({ \
68357 float32x2_t __ret_887; \
68358 float32x2_t __s0_887 = __p0_887; \
68359 float16x4_t __s1_887 = __p1_887; \
68360 float16x4_t __s2_887 = __p2_887; \
68361 __ret_887 = vfmlal_high_f16(__s0_887, __s1_887, (float16x4_t) {vget_lane_f16(__s2_887, __p3_887), vget_lane_f16(__s2_887, __p3_887), vget_lane_f16(__s2_887, __p3_887), vget_lane_f16(__s2_887, __p3_887)}); \
68362 __ret_887; \
68363})
68364#else
68365#define vfmlal_lane_high_f16(__p0_888, __p1_888, __p2_888, __p3_888) __extension__ ({ \
68366 float32x2_t __ret_888; \
68367 float32x2_t __s0_888 = __p0_888; \
68368 float16x4_t __s1_888 = __p1_888; \
68369 float16x4_t __s2_888 = __p2_888; \
68370 float32x2_t __rev0_888; __rev0_888 = __builtin_shufflevector(__s0_888, __s0_888, 1, 0); \
68371 float16x4_t __rev1_888; __rev1_888 = __builtin_shufflevector(__s1_888, __s1_888, 3, 2, 1, 0); \
68372 float16x4_t __rev2_888; __rev2_888 = __builtin_shufflevector(__s2_888, __s2_888, 3, 2, 1, 0); \
68373 __ret_888 = __noswap_vfmlal_high_f16(__rev0_888, __rev1_888, (float16x4_t) {__noswap_vget_lane_f16(__rev2_888, __p3_888), __noswap_vget_lane_f16(__rev2_888, __p3_888), __noswap_vget_lane_f16(__rev2_888, __p3_888), __noswap_vget_lane_f16(__rev2_888, __p3_888)}); \
68374 __ret_888 = __builtin_shufflevector(__ret_888, __ret_888, 1, 0); \
68375 __ret_888; \
68376})
68377#endif
68378
68379#ifdef __LITTLE_ENDIAN__
68380#define vfmlalq_lane_low_f16(__p0_889, __p1_889, __p2_889, __p3_889) __extension__ ({ \
68381 float32x4_t __ret_889; \
68382 float32x4_t __s0_889 = __p0_889; \
68383 float16x8_t __s1_889 = __p1_889; \
68384 float16x4_t __s2_889 = __p2_889; \
68385 __ret_889 = vfmlalq_low_f16(__s0_889, __s1_889, (float16x8_t) {vget_lane_f16(__s2_889, __p3_889), vget_lane_f16(__s2_889, __p3_889), vget_lane_f16(__s2_889, __p3_889), vget_lane_f16(__s2_889, __p3_889), vget_lane_f16(__s2_889, __p3_889), vget_lane_f16(__s2_889, __p3_889), vget_lane_f16(__s2_889, __p3_889), vget_lane_f16(__s2_889, __p3_889)}); \
68386 __ret_889; \
68387})
68388#else
68389#define vfmlalq_lane_low_f16(__p0_890, __p1_890, __p2_890, __p3_890) __extension__ ({ \
68390 float32x4_t __ret_890; \
68391 float32x4_t __s0_890 = __p0_890; \
68392 float16x8_t __s1_890 = __p1_890; \
68393 float16x4_t __s2_890 = __p2_890; \
68394 float32x4_t __rev0_890; __rev0_890 = __builtin_shufflevector(__s0_890, __s0_890, 3, 2, 1, 0); \
68395 float16x8_t __rev1_890; __rev1_890 = __builtin_shufflevector(__s1_890, __s1_890, 7, 6, 5, 4, 3, 2, 1, 0); \
68396 float16x4_t __rev2_890; __rev2_890 = __builtin_shufflevector(__s2_890, __s2_890, 3, 2, 1, 0); \
68397 __ret_890 = __noswap_vfmlalq_low_f16(__rev0_890, __rev1_890, (float16x8_t) {__noswap_vget_lane_f16(__rev2_890, __p3_890), __noswap_vget_lane_f16(__rev2_890, __p3_890), __noswap_vget_lane_f16(__rev2_890, __p3_890), __noswap_vget_lane_f16(__rev2_890, __p3_890), __noswap_vget_lane_f16(__rev2_890, __p3_890), __noswap_vget_lane_f16(__rev2_890, __p3_890), __noswap_vget_lane_f16(__rev2_890, __p3_890), __noswap_vget_lane_f16(__rev2_890, __p3_890)}); \
68398 __ret_890 = __builtin_shufflevector(__ret_890, __ret_890, 3, 2, 1, 0); \
68399 __ret_890; \
68400})
68401#endif
68402
68403#ifdef __LITTLE_ENDIAN__
68404#define vfmlal_lane_low_f16(__p0_891, __p1_891, __p2_891, __p3_891) __extension__ ({ \
68405 float32x2_t __ret_891; \
68406 float32x2_t __s0_891 = __p0_891; \
68407 float16x4_t __s1_891 = __p1_891; \
68408 float16x4_t __s2_891 = __p2_891; \
68409 __ret_891 = vfmlal_low_f16(__s0_891, __s1_891, (float16x4_t) {vget_lane_f16(__s2_891, __p3_891), vget_lane_f16(__s2_891, __p3_891), vget_lane_f16(__s2_891, __p3_891), vget_lane_f16(__s2_891, __p3_891)}); \
68410 __ret_891; \
68411})
68412#else
68413#define vfmlal_lane_low_f16(__p0_892, __p1_892, __p2_892, __p3_892) __extension__ ({ \
68414 float32x2_t __ret_892; \
68415 float32x2_t __s0_892 = __p0_892; \
68416 float16x4_t __s1_892 = __p1_892; \
68417 float16x4_t __s2_892 = __p2_892; \
68418 float32x2_t __rev0_892; __rev0_892 = __builtin_shufflevector(__s0_892, __s0_892, 1, 0); \
68419 float16x4_t __rev1_892; __rev1_892 = __builtin_shufflevector(__s1_892, __s1_892, 3, 2, 1, 0); \
68420 float16x4_t __rev2_892; __rev2_892 = __builtin_shufflevector(__s2_892, __s2_892, 3, 2, 1, 0); \
68421 __ret_892 = __noswap_vfmlal_low_f16(__rev0_892, __rev1_892, (float16x4_t) {__noswap_vget_lane_f16(__rev2_892, __p3_892), __noswap_vget_lane_f16(__rev2_892, __p3_892), __noswap_vget_lane_f16(__rev2_892, __p3_892), __noswap_vget_lane_f16(__rev2_892, __p3_892)}); \
68422 __ret_892 = __builtin_shufflevector(__ret_892, __ret_892, 1, 0); \
68423 __ret_892; \
68424})
68425#endif
68426
68427#ifdef __LITTLE_ENDIAN__
68428#define vfmlalq_laneq_high_f16(__p0_893, __p1_893, __p2_893, __p3_893) __extension__ ({ \
68429 float32x4_t __ret_893; \
68430 float32x4_t __s0_893 = __p0_893; \
68431 float16x8_t __s1_893 = __p1_893; \
68432 float16x8_t __s2_893 = __p2_893; \
68433 __ret_893 = vfmlalq_high_f16(__s0_893, __s1_893, (float16x8_t) {vgetq_lane_f16(__s2_893, __p3_893), vgetq_lane_f16(__s2_893, __p3_893), vgetq_lane_f16(__s2_893, __p3_893), vgetq_lane_f16(__s2_893, __p3_893), vgetq_lane_f16(__s2_893, __p3_893), vgetq_lane_f16(__s2_893, __p3_893), vgetq_lane_f16(__s2_893, __p3_893), vgetq_lane_f16(__s2_893, __p3_893)}); \
68434 __ret_893; \
68435})
68436#else
68437#define vfmlalq_laneq_high_f16(__p0_894, __p1_894, __p2_894, __p3_894) __extension__ ({ \
68438 float32x4_t __ret_894; \
68439 float32x4_t __s0_894 = __p0_894; \
68440 float16x8_t __s1_894 = __p1_894; \
68441 float16x8_t __s2_894 = __p2_894; \
68442 float32x4_t __rev0_894; __rev0_894 = __builtin_shufflevector(__s0_894, __s0_894, 3, 2, 1, 0); \
68443 float16x8_t __rev1_894; __rev1_894 = __builtin_shufflevector(__s1_894, __s1_894, 7, 6, 5, 4, 3, 2, 1, 0); \
68444 float16x8_t __rev2_894; __rev2_894 = __builtin_shufflevector(__s2_894, __s2_894, 7, 6, 5, 4, 3, 2, 1, 0); \
68445 __ret_894 = __noswap_vfmlalq_high_f16(__rev0_894, __rev1_894, (float16x8_t) {__noswap_vgetq_lane_f16(__rev2_894, __p3_894), __noswap_vgetq_lane_f16(__rev2_894, __p3_894), __noswap_vgetq_lane_f16(__rev2_894, __p3_894), __noswap_vgetq_lane_f16(__rev2_894, __p3_894), __noswap_vgetq_lane_f16(__rev2_894, __p3_894), __noswap_vgetq_lane_f16(__rev2_894, __p3_894), __noswap_vgetq_lane_f16(__rev2_894, __p3_894), __noswap_vgetq_lane_f16(__rev2_894, __p3_894)}); \
68446 __ret_894 = __builtin_shufflevector(__ret_894, __ret_894, 3, 2, 1, 0); \
68447 __ret_894; \
68448})
68449#endif
68450
68451#ifdef __LITTLE_ENDIAN__
68452#define vfmlal_laneq_high_f16(__p0_895, __p1_895, __p2_895, __p3_895) __extension__ ({ \
68453 float32x2_t __ret_895; \
68454 float32x2_t __s0_895 = __p0_895; \
68455 float16x4_t __s1_895 = __p1_895; \
68456 float16x8_t __s2_895 = __p2_895; \
68457 __ret_895 = vfmlal_high_f16(__s0_895, __s1_895, (float16x4_t) {vgetq_lane_f16(__s2_895, __p3_895), vgetq_lane_f16(__s2_895, __p3_895), vgetq_lane_f16(__s2_895, __p3_895), vgetq_lane_f16(__s2_895, __p3_895)}); \
68458 __ret_895; \
68459})
68460#else
68461#define vfmlal_laneq_high_f16(__p0_896, __p1_896, __p2_896, __p3_896) __extension__ ({ \
68462 float32x2_t __ret_896; \
68463 float32x2_t __s0_896 = __p0_896; \
68464 float16x4_t __s1_896 = __p1_896; \
68465 float16x8_t __s2_896 = __p2_896; \
68466 float32x2_t __rev0_896; __rev0_896 = __builtin_shufflevector(__s0_896, __s0_896, 1, 0); \
68467 float16x4_t __rev1_896; __rev1_896 = __builtin_shufflevector(__s1_896, __s1_896, 3, 2, 1, 0); \
68468 float16x8_t __rev2_896; __rev2_896 = __builtin_shufflevector(__s2_896, __s2_896, 7, 6, 5, 4, 3, 2, 1, 0); \
68469 __ret_896 = __noswap_vfmlal_high_f16(__rev0_896, __rev1_896, (float16x4_t) {__noswap_vgetq_lane_f16(__rev2_896, __p3_896), __noswap_vgetq_lane_f16(__rev2_896, __p3_896), __noswap_vgetq_lane_f16(__rev2_896, __p3_896), __noswap_vgetq_lane_f16(__rev2_896, __p3_896)}); \
68470 __ret_896 = __builtin_shufflevector(__ret_896, __ret_896, 1, 0); \
68471 __ret_896; \
68472})
68473#endif
68474
68475#ifdef __LITTLE_ENDIAN__
68476#define vfmlalq_laneq_low_f16(__p0_897, __p1_897, __p2_897, __p3_897) __extension__ ({ \
68477 float32x4_t __ret_897; \
68478 float32x4_t __s0_897 = __p0_897; \
68479 float16x8_t __s1_897 = __p1_897; \
68480 float16x8_t __s2_897 = __p2_897; \
68481 __ret_897 = vfmlalq_low_f16(__s0_897, __s1_897, (float16x8_t) {vgetq_lane_f16(__s2_897, __p3_897), vgetq_lane_f16(__s2_897, __p3_897), vgetq_lane_f16(__s2_897, __p3_897), vgetq_lane_f16(__s2_897, __p3_897), vgetq_lane_f16(__s2_897, __p3_897), vgetq_lane_f16(__s2_897, __p3_897), vgetq_lane_f16(__s2_897, __p3_897), vgetq_lane_f16(__s2_897, __p3_897)}); \
68482 __ret_897; \
68483})
68484#else
68485#define vfmlalq_laneq_low_f16(__p0_898, __p1_898, __p2_898, __p3_898) __extension__ ({ \
68486 float32x4_t __ret_898; \
68487 float32x4_t __s0_898 = __p0_898; \
68488 float16x8_t __s1_898 = __p1_898; \
68489 float16x8_t __s2_898 = __p2_898; \
68490 float32x4_t __rev0_898; __rev0_898 = __builtin_shufflevector(__s0_898, __s0_898, 3, 2, 1, 0); \
68491 float16x8_t __rev1_898; __rev1_898 = __builtin_shufflevector(__s1_898, __s1_898, 7, 6, 5, 4, 3, 2, 1, 0); \
68492 float16x8_t __rev2_898; __rev2_898 = __builtin_shufflevector(__s2_898, __s2_898, 7, 6, 5, 4, 3, 2, 1, 0); \
68493 __ret_898 = __noswap_vfmlalq_low_f16(__rev0_898, __rev1_898, (float16x8_t) {__noswap_vgetq_lane_f16(__rev2_898, __p3_898), __noswap_vgetq_lane_f16(__rev2_898, __p3_898), __noswap_vgetq_lane_f16(__rev2_898, __p3_898), __noswap_vgetq_lane_f16(__rev2_898, __p3_898), __noswap_vgetq_lane_f16(__rev2_898, __p3_898), __noswap_vgetq_lane_f16(__rev2_898, __p3_898), __noswap_vgetq_lane_f16(__rev2_898, __p3_898), __noswap_vgetq_lane_f16(__rev2_898, __p3_898)}); \
68494 __ret_898 = __builtin_shufflevector(__ret_898, __ret_898, 3, 2, 1, 0); \
68495 __ret_898; \
68496})
68497#endif
68498
68499#ifdef __LITTLE_ENDIAN__
68500#define vfmlal_laneq_low_f16(__p0_899, __p1_899, __p2_899, __p3_899) __extension__ ({ \
68501 float32x2_t __ret_899; \
68502 float32x2_t __s0_899 = __p0_899; \
68503 float16x4_t __s1_899 = __p1_899; \
68504 float16x8_t __s2_899 = __p2_899; \
68505 __ret_899 = vfmlal_low_f16(__s0_899, __s1_899, (float16x4_t) {vgetq_lane_f16(__s2_899, __p3_899), vgetq_lane_f16(__s2_899, __p3_899), vgetq_lane_f16(__s2_899, __p3_899), vgetq_lane_f16(__s2_899, __p3_899)}); \
68506 __ret_899; \
68507})
68508#else
68509#define vfmlal_laneq_low_f16(__p0_900, __p1_900, __p2_900, __p3_900) __extension__ ({ \
68510 float32x2_t __ret_900; \
68511 float32x2_t __s0_900 = __p0_900; \
68512 float16x4_t __s1_900 = __p1_900; \
68513 float16x8_t __s2_900 = __p2_900; \
68514 float32x2_t __rev0_900; __rev0_900 = __builtin_shufflevector(__s0_900, __s0_900, 1, 0); \
68515 float16x4_t __rev1_900; __rev1_900 = __builtin_shufflevector(__s1_900, __s1_900, 3, 2, 1, 0); \
68516 float16x8_t __rev2_900; __rev2_900 = __builtin_shufflevector(__s2_900, __s2_900, 7, 6, 5, 4, 3, 2, 1, 0); \
68517 __ret_900 = __noswap_vfmlal_low_f16(__rev0_900, __rev1_900, (float16x4_t) {__noswap_vgetq_lane_f16(__rev2_900, __p3_900), __noswap_vgetq_lane_f16(__rev2_900, __p3_900), __noswap_vgetq_lane_f16(__rev2_900, __p3_900), __noswap_vgetq_lane_f16(__rev2_900, __p3_900)}); \
68518 __ret_900 = __builtin_shufflevector(__ret_900, __ret_900, 1, 0); \
68519 __ret_900; \
68520})
68521#endif
68522
68523#ifdef __LITTLE_ENDIAN__
68524#define vfmlslq_lane_high_f16(__p0_901, __p1_901, __p2_901, __p3_901) __extension__ ({ \
68525 float32x4_t __ret_901; \
68526 float32x4_t __s0_901 = __p0_901; \
68527 float16x8_t __s1_901 = __p1_901; \
68528 float16x4_t __s2_901 = __p2_901; \
68529 __ret_901 = vfmlslq_high_f16(__s0_901, __s1_901, (float16x8_t) {vget_lane_f16(__s2_901, __p3_901), vget_lane_f16(__s2_901, __p3_901), vget_lane_f16(__s2_901, __p3_901), vget_lane_f16(__s2_901, __p3_901), vget_lane_f16(__s2_901, __p3_901), vget_lane_f16(__s2_901, __p3_901), vget_lane_f16(__s2_901, __p3_901), vget_lane_f16(__s2_901, __p3_901)}); \
68530 __ret_901; \
68531})
68532#else
68533#define vfmlslq_lane_high_f16(__p0_902, __p1_902, __p2_902, __p3_902) __extension__ ({ \
68534 float32x4_t __ret_902; \
68535 float32x4_t __s0_902 = __p0_902; \
68536 float16x8_t __s1_902 = __p1_902; \
68537 float16x4_t __s2_902 = __p2_902; \
68538 float32x4_t __rev0_902; __rev0_902 = __builtin_shufflevector(__s0_902, __s0_902, 3, 2, 1, 0); \
68539 float16x8_t __rev1_902; __rev1_902 = __builtin_shufflevector(__s1_902, __s1_902, 7, 6, 5, 4, 3, 2, 1, 0); \
68540 float16x4_t __rev2_902; __rev2_902 = __builtin_shufflevector(__s2_902, __s2_902, 3, 2, 1, 0); \
68541 __ret_902 = __noswap_vfmlslq_high_f16(__rev0_902, __rev1_902, (float16x8_t) {__noswap_vget_lane_f16(__rev2_902, __p3_902), __noswap_vget_lane_f16(__rev2_902, __p3_902), __noswap_vget_lane_f16(__rev2_902, __p3_902), __noswap_vget_lane_f16(__rev2_902, __p3_902), __noswap_vget_lane_f16(__rev2_902, __p3_902), __noswap_vget_lane_f16(__rev2_902, __p3_902), __noswap_vget_lane_f16(__rev2_902, __p3_902), __noswap_vget_lane_f16(__rev2_902, __p3_902)}); \
68542 __ret_902 = __builtin_shufflevector(__ret_902, __ret_902, 3, 2, 1, 0); \
68543 __ret_902; \
68544})
68545#endif
68546
68547#ifdef __LITTLE_ENDIAN__
68548#define vfmlsl_lane_high_f16(__p0_903, __p1_903, __p2_903, __p3_903) __extension__ ({ \
68549 float32x2_t __ret_903; \
68550 float32x2_t __s0_903 = __p0_903; \
68551 float16x4_t __s1_903 = __p1_903; \
68552 float16x4_t __s2_903 = __p2_903; \
68553 __ret_903 = vfmlsl_high_f16(__s0_903, __s1_903, (float16x4_t) {vget_lane_f16(__s2_903, __p3_903), vget_lane_f16(__s2_903, __p3_903), vget_lane_f16(__s2_903, __p3_903), vget_lane_f16(__s2_903, __p3_903)}); \
68554 __ret_903; \
68555})
68556#else
68557#define vfmlsl_lane_high_f16(__p0_904, __p1_904, __p2_904, __p3_904) __extension__ ({ \
68558 float32x2_t __ret_904; \
68559 float32x2_t __s0_904 = __p0_904; \
68560 float16x4_t __s1_904 = __p1_904; \
68561 float16x4_t __s2_904 = __p2_904; \
68562 float32x2_t __rev0_904; __rev0_904 = __builtin_shufflevector(__s0_904, __s0_904, 1, 0); \
68563 float16x4_t __rev1_904; __rev1_904 = __builtin_shufflevector(__s1_904, __s1_904, 3, 2, 1, 0); \
68564 float16x4_t __rev2_904; __rev2_904 = __builtin_shufflevector(__s2_904, __s2_904, 3, 2, 1, 0); \
68565 __ret_904 = __noswap_vfmlsl_high_f16(__rev0_904, __rev1_904, (float16x4_t) {__noswap_vget_lane_f16(__rev2_904, __p3_904), __noswap_vget_lane_f16(__rev2_904, __p3_904), __noswap_vget_lane_f16(__rev2_904, __p3_904), __noswap_vget_lane_f16(__rev2_904, __p3_904)}); \
68566 __ret_904 = __builtin_shufflevector(__ret_904, __ret_904, 1, 0); \
68567 __ret_904; \
68568})
68569#endif
68570
68571#ifdef __LITTLE_ENDIAN__
68572#define vfmlslq_lane_low_f16(__p0_905, __p1_905, __p2_905, __p3_905) __extension__ ({ \
68573 float32x4_t __ret_905; \
68574 float32x4_t __s0_905 = __p0_905; \
68575 float16x8_t __s1_905 = __p1_905; \
68576 float16x4_t __s2_905 = __p2_905; \
68577 __ret_905 = vfmlslq_low_f16(__s0_905, __s1_905, (float16x8_t) {vget_lane_f16(__s2_905, __p3_905), vget_lane_f16(__s2_905, __p3_905), vget_lane_f16(__s2_905, __p3_905), vget_lane_f16(__s2_905, __p3_905), vget_lane_f16(__s2_905, __p3_905), vget_lane_f16(__s2_905, __p3_905), vget_lane_f16(__s2_905, __p3_905), vget_lane_f16(__s2_905, __p3_905)}); \
68578 __ret_905; \
68579})
68580#else
68581#define vfmlslq_lane_low_f16(__p0_906, __p1_906, __p2_906, __p3_906) __extension__ ({ \
68582 float32x4_t __ret_906; \
68583 float32x4_t __s0_906 = __p0_906; \
68584 float16x8_t __s1_906 = __p1_906; \
68585 float16x4_t __s2_906 = __p2_906; \
68586 float32x4_t __rev0_906; __rev0_906 = __builtin_shufflevector(__s0_906, __s0_906, 3, 2, 1, 0); \
68587 float16x8_t __rev1_906; __rev1_906 = __builtin_shufflevector(__s1_906, __s1_906, 7, 6, 5, 4, 3, 2, 1, 0); \
68588 float16x4_t __rev2_906; __rev2_906 = __builtin_shufflevector(__s2_906, __s2_906, 3, 2, 1, 0); \
68589 __ret_906 = __noswap_vfmlslq_low_f16(__rev0_906, __rev1_906, (float16x8_t) {__noswap_vget_lane_f16(__rev2_906, __p3_906), __noswap_vget_lane_f16(__rev2_906, __p3_906), __noswap_vget_lane_f16(__rev2_906, __p3_906), __noswap_vget_lane_f16(__rev2_906, __p3_906), __noswap_vget_lane_f16(__rev2_906, __p3_906), __noswap_vget_lane_f16(__rev2_906, __p3_906), __noswap_vget_lane_f16(__rev2_906, __p3_906), __noswap_vget_lane_f16(__rev2_906, __p3_906)}); \
68590 __ret_906 = __builtin_shufflevector(__ret_906, __ret_906, 3, 2, 1, 0); \
68591 __ret_906; \
68592})
68593#endif
68594
68595#ifdef __LITTLE_ENDIAN__
68596#define vfmlsl_lane_low_f16(__p0_907, __p1_907, __p2_907, __p3_907) __extension__ ({ \
68597 float32x2_t __ret_907; \
68598 float32x2_t __s0_907 = __p0_907; \
68599 float16x4_t __s1_907 = __p1_907; \
68600 float16x4_t __s2_907 = __p2_907; \
68601 __ret_907 = vfmlsl_low_f16(__s0_907, __s1_907, (float16x4_t) {vget_lane_f16(__s2_907, __p3_907), vget_lane_f16(__s2_907, __p3_907), vget_lane_f16(__s2_907, __p3_907), vget_lane_f16(__s2_907, __p3_907)}); \
68602 __ret_907; \
68603})
68604#else
68605#define vfmlsl_lane_low_f16(__p0_908, __p1_908, __p2_908, __p3_908) __extension__ ({ \
68606 float32x2_t __ret_908; \
68607 float32x2_t __s0_908 = __p0_908; \
68608 float16x4_t __s1_908 = __p1_908; \
68609 float16x4_t __s2_908 = __p2_908; \
68610 float32x2_t __rev0_908; __rev0_908 = __builtin_shufflevector(__s0_908, __s0_908, 1, 0); \
68611 float16x4_t __rev1_908; __rev1_908 = __builtin_shufflevector(__s1_908, __s1_908, 3, 2, 1, 0); \
68612 float16x4_t __rev2_908; __rev2_908 = __builtin_shufflevector(__s2_908, __s2_908, 3, 2, 1, 0); \
68613 __ret_908 = __noswap_vfmlsl_low_f16(__rev0_908, __rev1_908, (float16x4_t) {__noswap_vget_lane_f16(__rev2_908, __p3_908), __noswap_vget_lane_f16(__rev2_908, __p3_908), __noswap_vget_lane_f16(__rev2_908, __p3_908), __noswap_vget_lane_f16(__rev2_908, __p3_908)}); \
68614 __ret_908 = __builtin_shufflevector(__ret_908, __ret_908, 1, 0); \
68615 __ret_908; \
68616})
68617#endif
68618
68619#ifdef __LITTLE_ENDIAN__
68620#define vfmlslq_laneq_high_f16(__p0_909, __p1_909, __p2_909, __p3_909) __extension__ ({ \
68621 float32x4_t __ret_909; \
68622 float32x4_t __s0_909 = __p0_909; \
68623 float16x8_t __s1_909 = __p1_909; \
68624 float16x8_t __s2_909 = __p2_909; \
68625 __ret_909 = vfmlslq_high_f16(__s0_909, __s1_909, (float16x8_t) {vgetq_lane_f16(__s2_909, __p3_909), vgetq_lane_f16(__s2_909, __p3_909), vgetq_lane_f16(__s2_909, __p3_909), vgetq_lane_f16(__s2_909, __p3_909), vgetq_lane_f16(__s2_909, __p3_909), vgetq_lane_f16(__s2_909, __p3_909), vgetq_lane_f16(__s2_909, __p3_909), vgetq_lane_f16(__s2_909, __p3_909)}); \
68626 __ret_909; \
68627})
68628#else
68629#define vfmlslq_laneq_high_f16(__p0_910, __p1_910, __p2_910, __p3_910) __extension__ ({ \
68630 float32x4_t __ret_910; \
68631 float32x4_t __s0_910 = __p0_910; \
68632 float16x8_t __s1_910 = __p1_910; \
68633 float16x8_t __s2_910 = __p2_910; \
68634 float32x4_t __rev0_910; __rev0_910 = __builtin_shufflevector(__s0_910, __s0_910, 3, 2, 1, 0); \
68635 float16x8_t __rev1_910; __rev1_910 = __builtin_shufflevector(__s1_910, __s1_910, 7, 6, 5, 4, 3, 2, 1, 0); \
68636 float16x8_t __rev2_910; __rev2_910 = __builtin_shufflevector(__s2_910, __s2_910, 7, 6, 5, 4, 3, 2, 1, 0); \
68637 __ret_910 = __noswap_vfmlslq_high_f16(__rev0_910, __rev1_910, (float16x8_t) {__noswap_vgetq_lane_f16(__rev2_910, __p3_910), __noswap_vgetq_lane_f16(__rev2_910, __p3_910), __noswap_vgetq_lane_f16(__rev2_910, __p3_910), __noswap_vgetq_lane_f16(__rev2_910, __p3_910), __noswap_vgetq_lane_f16(__rev2_910, __p3_910), __noswap_vgetq_lane_f16(__rev2_910, __p3_910), __noswap_vgetq_lane_f16(__rev2_910, __p3_910), __noswap_vgetq_lane_f16(__rev2_910, __p3_910)}); \
68638 __ret_910 = __builtin_shufflevector(__ret_910, __ret_910, 3, 2, 1, 0); \
68639 __ret_910; \
68640})
68641#endif
68642
68643#ifdef __LITTLE_ENDIAN__
68644#define vfmlsl_laneq_high_f16(__p0_911, __p1_911, __p2_911, __p3_911) __extension__ ({ \
68645 float32x2_t __ret_911; \
68646 float32x2_t __s0_911 = __p0_911; \
68647 float16x4_t __s1_911 = __p1_911; \
68648 float16x8_t __s2_911 = __p2_911; \
68649 __ret_911 = vfmlsl_high_f16(__s0_911, __s1_911, (float16x4_t) {vgetq_lane_f16(__s2_911, __p3_911), vgetq_lane_f16(__s2_911, __p3_911), vgetq_lane_f16(__s2_911, __p3_911), vgetq_lane_f16(__s2_911, __p3_911)}); \
68650 __ret_911; \
68651})
68652#else
68653#define vfmlsl_laneq_high_f16(__p0_912, __p1_912, __p2_912, __p3_912) __extension__ ({ \
68654 float32x2_t __ret_912; \
68655 float32x2_t __s0_912 = __p0_912; \
68656 float16x4_t __s1_912 = __p1_912; \
68657 float16x8_t __s2_912 = __p2_912; \
68658 float32x2_t __rev0_912; __rev0_912 = __builtin_shufflevector(__s0_912, __s0_912, 1, 0); \
68659 float16x4_t __rev1_912; __rev1_912 = __builtin_shufflevector(__s1_912, __s1_912, 3, 2, 1, 0); \
68660 float16x8_t __rev2_912; __rev2_912 = __builtin_shufflevector(__s2_912, __s2_912, 7, 6, 5, 4, 3, 2, 1, 0); \
68661 __ret_912 = __noswap_vfmlsl_high_f16(__rev0_912, __rev1_912, (float16x4_t) {__noswap_vgetq_lane_f16(__rev2_912, __p3_912), __noswap_vgetq_lane_f16(__rev2_912, __p3_912), __noswap_vgetq_lane_f16(__rev2_912, __p3_912), __noswap_vgetq_lane_f16(__rev2_912, __p3_912)}); \
68662 __ret_912 = __builtin_shufflevector(__ret_912, __ret_912, 1, 0); \
68663 __ret_912; \
68664})
68665#endif
68666
68667#ifdef __LITTLE_ENDIAN__
68668#define vfmlslq_laneq_low_f16(__p0_913, __p1_913, __p2_913, __p3_913) __extension__ ({ \
68669 float32x4_t __ret_913; \
68670 float32x4_t __s0_913 = __p0_913; \
68671 float16x8_t __s1_913 = __p1_913; \
68672 float16x8_t __s2_913 = __p2_913; \
68673 __ret_913 = vfmlslq_low_f16(__s0_913, __s1_913, (float16x8_t) {vgetq_lane_f16(__s2_913, __p3_913), vgetq_lane_f16(__s2_913, __p3_913), vgetq_lane_f16(__s2_913, __p3_913), vgetq_lane_f16(__s2_913, __p3_913), vgetq_lane_f16(__s2_913, __p3_913), vgetq_lane_f16(__s2_913, __p3_913), vgetq_lane_f16(__s2_913, __p3_913), vgetq_lane_f16(__s2_913, __p3_913)}); \
68674 __ret_913; \
68675})
68676#else
68677#define vfmlslq_laneq_low_f16(__p0_914, __p1_914, __p2_914, __p3_914) __extension__ ({ \
68678 float32x4_t __ret_914; \
68679 float32x4_t __s0_914 = __p0_914; \
68680 float16x8_t __s1_914 = __p1_914; \
68681 float16x8_t __s2_914 = __p2_914; \
68682 float32x4_t __rev0_914; __rev0_914 = __builtin_shufflevector(__s0_914, __s0_914, 3, 2, 1, 0); \
68683 float16x8_t __rev1_914; __rev1_914 = __builtin_shufflevector(__s1_914, __s1_914, 7, 6, 5, 4, 3, 2, 1, 0); \
68684 float16x8_t __rev2_914; __rev2_914 = __builtin_shufflevector(__s2_914, __s2_914, 7, 6, 5, 4, 3, 2, 1, 0); \
68685 __ret_914 = __noswap_vfmlslq_low_f16(__rev0_914, __rev1_914, (float16x8_t) {__noswap_vgetq_lane_f16(__rev2_914, __p3_914), __noswap_vgetq_lane_f16(__rev2_914, __p3_914), __noswap_vgetq_lane_f16(__rev2_914, __p3_914), __noswap_vgetq_lane_f16(__rev2_914, __p3_914), __noswap_vgetq_lane_f16(__rev2_914, __p3_914), __noswap_vgetq_lane_f16(__rev2_914, __p3_914), __noswap_vgetq_lane_f16(__rev2_914, __p3_914), __noswap_vgetq_lane_f16(__rev2_914, __p3_914)}); \
68686 __ret_914 = __builtin_shufflevector(__ret_914, __ret_914, 3, 2, 1, 0); \
68687 __ret_914; \
68688})
68689#endif
68690
6869168166#ifdef __LITTLE_ENDIAN__
68692#define vfmlsl_laneq_low_f16(__p0_915, __p1_915, __p2_915, __p3_915) __extension__ ({ \
68693 float32x2_t __ret_915; \
68694 float32x2_t __s0_915 = __p0_915; \
68695 float16x4_t __s1_915 = __p1_915; \
68696 float16x8_t __s2_915 = __p2_915; \
68697 __ret_915 = vfmlsl_low_f16(__s0_915, __s1_915, (float16x4_t) {vgetq_lane_f16(__s2_915, __p3_915), vgetq_lane_f16(__s2_915, __p3_915), vgetq_lane_f16(__s2_915, __p3_915), vgetq_lane_f16(__s2_915, __p3_915)}); \
68698 __ret_915; \
68699})
68700#else
68701#define vfmlsl_laneq_low_f16(__p0_916, __p1_916, __p2_916, __p3_916) __extension__ ({ \
68702 float32x2_t __ret_916; \
68703 float32x2_t __s0_916 = __p0_916; \
68704 float16x4_t __s1_916 = __p1_916; \
68705 float16x8_t __s2_916 = __p2_916; \
68706 float32x2_t __rev0_916; __rev0_916 = __builtin_shufflevector(__s0_916, __s0_916, 1, 0); \
68707 float16x4_t __rev1_916; __rev1_916 = __builtin_shufflevector(__s1_916, __s1_916, 3, 2, 1, 0); \
68708 float16x8_t __rev2_916; __rev2_916 = __builtin_shufflevector(__s2_916, __s2_916, 7, 6, 5, 4, 3, 2, 1, 0); \
68709 __ret_916 = __noswap_vfmlsl_low_f16(__rev0_916, __rev1_916, (float16x4_t) {__noswap_vgetq_lane_f16(__rev2_916, __p3_916), __noswap_vgetq_lane_f16(__rev2_916, __p3_916), __noswap_vgetq_lane_f16(__rev2_916, __p3_916), __noswap_vgetq_lane_f16(__rev2_916, __p3_916)}); \
68710 __ret_916 = __builtin_shufflevector(__ret_916, __ret_916, 1, 0); \
68711 __ret_916; \
68712})
68713#endif
68714
68715#endif
68716#if defined(__ARM_FEATURE_FP16_VECTOR_ARITHMETIC) && defined(__aarch64__)
68717#ifdef __LITTLE_ENDIAN__
68718#define vmulh_lane_f16(__p0_917, __p1_917, __p2_917) __extension__ ({ \
68719 float16_t __ret_917; \
68720 float16_t __s0_917 = __p0_917; \
68721 float16x4_t __s1_917 = __p1_917; \
68722 __ret_917 = __s0_917 * vget_lane_f16(__s1_917, __p2_917); \
68723 __ret_917; \
68724})
68725#else
68726#define vmulh_lane_f16(__p0_918, __p1_918, __p2_918) __extension__ ({ \
68727 float16_t __ret_918; \
68728 float16_t __s0_918 = __p0_918; \
68729 float16x4_t __s1_918 = __p1_918; \
68730 float16x4_t __rev1_918; __rev1_918 = __builtin_shufflevector(__s1_918, __s1_918, 3, 2, 1, 0); \
68731 __ret_918 = __s0_918 * __noswap_vget_lane_f16(__rev1_918, __p2_918); \
68732 __ret_918; \
68733})
68734#endif
68735
68736#ifdef __LITTLE_ENDIAN__
68737#define vmulh_laneq_f16(__p0_919, __p1_919, __p2_919) __extension__ ({ \
68738 float16_t __ret_919; \
68739 float16_t __s0_919 = __p0_919; \
68740 float16x8_t __s1_919 = __p1_919; \
68741 __ret_919 = __s0_919 * vgetq_lane_f16(__s1_919, __p2_919); \
68742 __ret_919; \
68743})
68744#else
68745#define vmulh_laneq_f16(__p0_920, __p1_920, __p2_920) __extension__ ({ \
68746 float16_t __ret_920; \
68747 float16_t __s0_920 = __p0_920; \
68748 float16x8_t __s1_920 = __p1_920; \
68749 float16x8_t __rev1_920; __rev1_920 = __builtin_shufflevector(__s1_920, __s1_920, 7, 6, 5, 4, 3, 2, 1, 0); \
68750 __ret_920 = __s0_920 * __noswap_vgetq_lane_f16(__rev1_920, __p2_920); \
68751 __ret_920; \
68752})
68753#endif
68754
68755#endif
68756#if defined(__ARM_FEATURE_MATMUL_INT8)
68757#ifdef __LITTLE_ENDIAN__
68758#define vsudotq_lane_s32(__p0_921, __p1_921, __p2_921, __p3_921) __extension__ ({ \
68759 int32x4_t __ret_921; \
68760 int32x4_t __s0_921 = __p0_921; \
68761 int8x16_t __s1_921 = __p1_921; \
68762 uint8x8_t __s2_921 = __p2_921; \
68763uint8x8_t __reint_921 = __s2_921; \
68764 __ret_921 = vusdotq_s32(__s0_921, (uint8x16_t)(splatq_lane_s32(*(int32x2_t *) &__reint_921, __p3_921)), __s1_921); \
68765 __ret_921; \
68167#define vsudotq_lane_s32(__p0_881, __p1_881, __p2_881, __p3_881) __extension__ ({ \
68168 int32x4_t __ret_881; \
68169 int32x4_t __s0_881 = __p0_881; \
68170 int8x16_t __s1_881 = __p1_881; \
68171 uint8x8_t __s2_881 = __p2_881; \
68172uint8x8_t __reint_881 = __s2_881; \
68173 __ret_881 = vusdotq_s32(__s0_881, (uint8x16_t)(splatq_lane_s32(*(int32x2_t *) &__reint_881, __p3_881)), __s1_881); \
68174 __ret_881; \
6876668175})
6876768176#else
68768#define vsudotq_lane_s32(__p0_922, __p1_922, __p2_922, __p3_922) __extension__ ({ \
68769 int32x4_t __ret_922; \
68770 int32x4_t __s0_922 = __p0_922; \
68771 int8x16_t __s1_922 = __p1_922; \
68772 uint8x8_t __s2_922 = __p2_922; \
68773 int32x4_t __rev0_922; __rev0_922 = __builtin_shufflevector(__s0_922, __s0_922, 3, 2, 1, 0); \
68774 int8x16_t __rev1_922; __rev1_922 = __builtin_shufflevector(__s1_922, __s1_922, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
68775 uint8x8_t __rev2_922; __rev2_922 = __builtin_shufflevector(__s2_922, __s2_922, 7, 6, 5, 4, 3, 2, 1, 0); \
68776uint8x8_t __reint_922 = __rev2_922; \
68777 __ret_922 = __noswap_vusdotq_s32(__rev0_922, (uint8x16_t)(__noswap_splatq_lane_s32(*(int32x2_t *) &__reint_922, __p3_922)), __rev1_922); \
68778 __ret_922 = __builtin_shufflevector(__ret_922, __ret_922, 3, 2, 1, 0); \
68779 __ret_922; \
68177#define vsudotq_lane_s32(__p0_882, __p1_882, __p2_882, __p3_882) __extension__ ({ \
68178 int32x4_t __ret_882; \
68179 int32x4_t __s0_882 = __p0_882; \
68180 int8x16_t __s1_882 = __p1_882; \
68181 uint8x8_t __s2_882 = __p2_882; \
68182 int32x4_t __rev0_882; __rev0_882 = __builtin_shufflevector(__s0_882, __s0_882, 3, 2, 1, 0); \
68183 int8x16_t __rev1_882; __rev1_882 = __builtin_shufflevector(__s1_882, __s1_882, 15, 14, 13, 12, 11, 10, 9, 8, 7, 6, 5, 4, 3, 2, 1, 0); \
68184 uint8x8_t __rev2_882; __rev2_882 = __builtin_shufflevector(__s2_882, __s2_882, 7, 6, 5, 4, 3, 2, 1, 0); \
68185uint8x8_t __reint_882 = __rev2_882; \
68186 __ret_882 = __noswap_vusdotq_s32(__rev0_882, (uint8x16_t)(__noswap_splatq_lane_s32(*(int32x2_t *) &__reint_882, __p3_882)), __rev1_882); \
68187 __ret_882 = __builtin_shufflevector(__ret_882, __ret_882, 3, 2, 1, 0); \
68188 __ret_882; \
6878068189})
6878168190#endif
6878268191
6878368192#ifdef __LITTLE_ENDIAN__
68784#define vsudot_lane_s32(__p0_923, __p1_923, __p2_923, __p3_923) __extension__ ({ \
68785 int32x2_t __ret_923; \
68786 int32x2_t __s0_923 = __p0_923; \
68787 int8x8_t __s1_923 = __p1_923; \
68788 uint8x8_t __s2_923 = __p2_923; \
68789uint8x8_t __reint_923 = __s2_923; \
68790 __ret_923 = vusdot_s32(__s0_923, (uint8x8_t)(splat_lane_s32(*(int32x2_t *) &__reint_923, __p3_923)), __s1_923); \
68791 __ret_923; \
68193#define vsudot_lane_s32(__p0_883, __p1_883, __p2_883, __p3_883) __extension__ ({ \
68194 int32x2_t __ret_883; \
68195 int32x2_t __s0_883 = __p0_883; \
68196 int8x8_t __s1_883 = __p1_883; \
68197 uint8x8_t __s2_883 = __p2_883; \
68198uint8x8_t __reint_883 = __s2_883; \
68199 __ret_883 = vusdot_s32(__s0_883, (uint8x8_t)(splat_lane_s32(*(int32x2_t *) &__reint_883, __p3_883)), __s1_883); \
68200 __ret_883; \
6879268201})
6879368202#else
68794#define vsudot_lane_s32(__p0_924, __p1_924, __p2_924, __p3_924) __extension__ ({ \
68795 int32x2_t __ret_924; \
68796 int32x2_t __s0_924 = __p0_924; \
68797 int8x8_t __s1_924 = __p1_924; \
68798 uint8x8_t __s2_924 = __p2_924; \
68799 int32x2_t __rev0_924; __rev0_924 = __builtin_shufflevector(__s0_924, __s0_924, 1, 0); \
68800 int8x8_t __rev1_924; __rev1_924 = __builtin_shufflevector(__s1_924, __s1_924, 7, 6, 5, 4, 3, 2, 1, 0); \
68801 uint8x8_t __rev2_924; __rev2_924 = __builtin_shufflevector(__s2_924, __s2_924, 7, 6, 5, 4, 3, 2, 1, 0); \
68802uint8x8_t __reint_924 = __rev2_924; \
68803 __ret_924 = __noswap_vusdot_s32(__rev0_924, (uint8x8_t)(__noswap_splat_lane_s32(*(int32x2_t *) &__reint_924, __p3_924)), __rev1_924); \
68804 __ret_924 = __builtin_shufflevector(__ret_924, __ret_924, 1, 0); \
68805 __ret_924; \
68203#define vsudot_lane_s32(__p0_884, __p1_884, __p2_884, __p3_884) __extension__ ({ \
68204 int32x2_t __ret_884; \
68205 int32x2_t __s0_884 = __p0_884; \
68206 int8x8_t __s1_884 = __p1_884; \
68207 uint8x8_t __s2_884 = __p2_884; \
68208 int32x2_t __rev0_884; __rev0_884 = __builtin_shufflevector(__s0_884, __s0_884, 1, 0); \
68209 int8x8_t __rev1_884; __rev1_884 = __builtin_shufflevector(__s1_884, __s1_884, 7, 6, 5, 4, 3, 2, 1, 0); \
68210 uint8x8_t __rev2_884; __rev2_884 = __builtin_shufflevector(__s2_884, __s2_884, 7, 6, 5, 4, 3, 2, 1, 0); \
68211uint8x8_t __reint_884 = __rev2_884; \
68212 __ret_884 = __noswap_vusdot_s32(__rev0_884, (uint8x8_t)(__noswap_splat_lane_s32(*(int32x2_t *) &__reint_884, __p3_884)), __rev1_884); \
68213 __ret_884 = __builtin_shufflevector(__ret_884, __ret_884, 1, 0); \
68214 __ret_884; \
6880668215})
6880768216#endif
6880868217
68809#endif
6881068218#if defined(__aarch64__)
6881168219#ifdef __LITTLE_ENDIAN__
6881268220__ai uint16x8_t vabdl_high_u8(uint8x16_t __p0, uint8x16_t __p1) {
......@@ -69115,136 +68523,136 @@ __ai int32x4_t vaddw_high_s16(int32x4_t __p0, int16x8_t __p1) {
6911568523#endif
6911668524
6911768525#ifdef __LITTLE_ENDIAN__
69118#define vcopyq_lane_p64(__p0_925, __p1_925, __p2_925, __p3_925) __extension__ ({ \
69119 poly64x2_t __ret_925; \
69120 poly64x2_t __s0_925 = __p0_925; \
69121 poly64x1_t __s2_925 = __p2_925; \
69122 __ret_925 = vsetq_lane_p64(vget_lane_p64(__s2_925, __p3_925), __s0_925, __p1_925); \
69123 __ret_925; \
68526#define vcopyq_lane_p64(__p0_885, __p1_885, __p2_885, __p3_885) __extension__ ({ \
68527 poly64x2_t __ret_885; \
68528 poly64x2_t __s0_885 = __p0_885; \
68529 poly64x1_t __s2_885 = __p2_885; \
68530 __ret_885 = vsetq_lane_p64(vget_lane_p64(__s2_885, __p3_885), __s0_885, __p1_885); \
68531 __ret_885; \
6912468532})
6912568533#else
69126#define vcopyq_lane_p64(__p0_926, __p1_926, __p2_926, __p3_926) __extension__ ({ \
69127 poly64x2_t __ret_926; \
69128 poly64x2_t __s0_926 = __p0_926; \
69129 poly64x1_t __s2_926 = __p2_926; \
69130 poly64x2_t __rev0_926; __rev0_926 = __builtin_shufflevector(__s0_926, __s0_926, 1, 0); \
69131 __ret_926 = __noswap_vsetq_lane_p64(vget_lane_p64(__s2_926, __p3_926), __rev0_926, __p1_926); \
69132 __ret_926 = __builtin_shufflevector(__ret_926, __ret_926, 1, 0); \
69133 __ret_926; \
68534#define vcopyq_lane_p64(__p0_886, __p1_886, __p2_886, __p3_886) __extension__ ({ \
68535 poly64x2_t __ret_886; \
68536 poly64x2_t __s0_886 = __p0_886; \
68537 poly64x1_t __s2_886 = __p2_886; \
68538 poly64x2_t __rev0_886; __rev0_886 = __builtin_shufflevector(__s0_886, __s0_886, 1, 0); \
68539 __ret_886 = __noswap_vsetq_lane_p64(vget_lane_p64(__s2_886, __p3_886), __rev0_886, __p1_886); \
68540 __ret_886 = __builtin_shufflevector(__ret_886, __ret_886, 1, 0); \
68541 __ret_886; \
6913468542})
6913568543#endif
6913668544
6913768545#ifdef __LITTLE_ENDIAN__
69138#define vcopyq_lane_f64(__p0_927, __p1_927, __p2_927, __p3_927) __extension__ ({ \
69139 float64x2_t __ret_927; \
69140 float64x2_t __s0_927 = __p0_927; \
69141 float64x1_t __s2_927 = __p2_927; \
69142 __ret_927 = vsetq_lane_f64(vget_lane_f64(__s2_927, __p3_927), __s0_927, __p1_927); \
69143 __ret_927; \
68546#define vcopyq_lane_f64(__p0_887, __p1_887, __p2_887, __p3_887) __extension__ ({ \
68547 float64x2_t __ret_887; \
68548 float64x2_t __s0_887 = __p0_887; \
68549 float64x1_t __s2_887 = __p2_887; \
68550 __ret_887 = vsetq_lane_f64(vget_lane_f64(__s2_887, __p3_887), __s0_887, __p1_887); \
68551 __ret_887; \
6914468552})
6914568553#else
69146#define vcopyq_lane_f64(__p0_928, __p1_928, __p2_928, __p3_928) __extension__ ({ \
69147 float64x2_t __ret_928; \
69148 float64x2_t __s0_928 = __p0_928; \
69149 float64x1_t __s2_928 = __p2_928; \
69150 float64x2_t __rev0_928; __rev0_928 = __builtin_shufflevector(__s0_928, __s0_928, 1, 0); \
69151 __ret_928 = __noswap_vsetq_lane_f64(vget_lane_f64(__s2_928, __p3_928), __rev0_928, __p1_928); \
69152 __ret_928 = __builtin_shufflevector(__ret_928, __ret_928, 1, 0); \
69153 __ret_928; \
68554#define vcopyq_lane_f64(__p0_888, __p1_888, __p2_888, __p3_888) __extension__ ({ \
68555 float64x2_t __ret_888; \
68556 float64x2_t __s0_888 = __p0_888; \
68557 float64x1_t __s2_888 = __p2_888; \
68558 float64x2_t __rev0_888; __rev0_888 = __builtin_shufflevector(__s0_888, __s0_888, 1, 0); \
68559 __ret_888 = __noswap_vsetq_lane_f64(vget_lane_f64(__s2_888, __p3_888), __rev0_888, __p1_888); \
68560 __ret_888 = __builtin_shufflevector(__ret_888, __ret_888, 1, 0); \
68561 __ret_888; \
6915468562})
6915568563#endif
6915668564
69157#define vcopy_lane_p64(__p0_929, __p1_929, __p2_929, __p3_929) __extension__ ({ \
69158 poly64x1_t __ret_929; \
69159 poly64x1_t __s0_929 = __p0_929; \
69160 poly64x1_t __s2_929 = __p2_929; \
69161 __ret_929 = vset_lane_p64(vget_lane_p64(__s2_929, __p3_929), __s0_929, __p1_929); \
69162 __ret_929; \
68565#define vcopy_lane_p64(__p0_889, __p1_889, __p2_889, __p3_889) __extension__ ({ \
68566 poly64x1_t __ret_889; \
68567 poly64x1_t __s0_889 = __p0_889; \
68568 poly64x1_t __s2_889 = __p2_889; \
68569 __ret_889 = vset_lane_p64(vget_lane_p64(__s2_889, __p3_889), __s0_889, __p1_889); \
68570 __ret_889; \
6916368571})
69164#define vcopy_lane_f64(__p0_930, __p1_930, __p2_930, __p3_930) __extension__ ({ \
69165 float64x1_t __ret_930; \
69166 float64x1_t __s0_930 = __p0_930; \
69167 float64x1_t __s2_930 = __p2_930; \
69168 __ret_930 = vset_lane_f64(vget_lane_f64(__s2_930, __p3_930), __s0_930, __p1_930); \
69169 __ret_930; \
68572#define vcopy_lane_f64(__p0_890, __p1_890, __p2_890, __p3_890) __extension__ ({ \
68573 float64x1_t __ret_890; \
68574 float64x1_t __s0_890 = __p0_890; \
68575 float64x1_t __s2_890 = __p2_890; \
68576 __ret_890 = vset_lane_f64(vget_lane_f64(__s2_890, __p3_890), __s0_890, __p1_890); \
68577 __ret_890; \
6917068578})
6917168579#ifdef __LITTLE_ENDIAN__
69172#define vcopyq_laneq_p64(__p0_931, __p1_931, __p2_931, __p3_931) __extension__ ({ \
69173 poly64x2_t __ret_931; \
69174 poly64x2_t __s0_931 = __p0_931; \
69175 poly64x2_t __s2_931 = __p2_931; \
69176 __ret_931 = vsetq_lane_p64(vgetq_lane_p64(__s2_931, __p3_931), __s0_931, __p1_931); \
69177 __ret_931; \
68580#define vcopyq_laneq_p64(__p0_891, __p1_891, __p2_891, __p3_891) __extension__ ({ \
68581 poly64x2_t __ret_891; \
68582 poly64x2_t __s0_891 = __p0_891; \
68583 poly64x2_t __s2_891 = __p2_891; \
68584 __ret_891 = vsetq_lane_p64(vgetq_lane_p64(__s2_891, __p3_891), __s0_891, __p1_891); \
68585 __ret_891; \
6917868586})
6917968587#else
69180#define vcopyq_laneq_p64(__p0_932, __p1_932, __p2_932, __p3_932) __extension__ ({ \
69181 poly64x2_t __ret_932; \
69182 poly64x2_t __s0_932 = __p0_932; \
69183 poly64x2_t __s2_932 = __p2_932; \
69184 poly64x2_t __rev0_932; __rev0_932 = __builtin_shufflevector(__s0_932, __s0_932, 1, 0); \
69185 poly64x2_t __rev2_932; __rev2_932 = __builtin_shufflevector(__s2_932, __s2_932, 1, 0); \
69186 __ret_932 = __noswap_vsetq_lane_p64(__noswap_vgetq_lane_p64(__rev2_932, __p3_932), __rev0_932, __p1_932); \
69187 __ret_932 = __builtin_shufflevector(__ret_932, __ret_932, 1, 0); \
69188 __ret_932; \
68588#define vcopyq_laneq_p64(__p0_892, __p1_892, __p2_892, __p3_892) __extension__ ({ \
68589 poly64x2_t __ret_892; \
68590 poly64x2_t __s0_892 = __p0_892; \
68591 poly64x2_t __s2_892 = __p2_892; \
68592 poly64x2_t __rev0_892; __rev0_892 = __builtin_shufflevector(__s0_892, __s0_892, 1, 0); \
68593 poly64x2_t __rev2_892; __rev2_892 = __builtin_shufflevector(__s2_892, __s2_892, 1, 0); \
68594 __ret_892 = __noswap_vsetq_lane_p64(__noswap_vgetq_lane_p64(__rev2_892, __p3_892), __rev0_892, __p1_892); \
68595 __ret_892 = __builtin_shufflevector(__ret_892, __ret_892, 1, 0); \
68596 __ret_892; \
6918968597})
6919068598#endif
6919168599
6919268600#ifdef __LITTLE_ENDIAN__
69193#define vcopyq_laneq_f64(__p0_933, __p1_933, __p2_933, __p3_933) __extension__ ({ \
69194 float64x2_t __ret_933; \
69195 float64x2_t __s0_933 = __p0_933; \
69196 float64x2_t __s2_933 = __p2_933; \
69197 __ret_933 = vsetq_lane_f64(vgetq_lane_f64(__s2_933, __p3_933), __s0_933, __p1_933); \
69198 __ret_933; \
68601#define vcopyq_laneq_f64(__p0_893, __p1_893, __p2_893, __p3_893) __extension__ ({ \
68602 float64x2_t __ret_893; \
68603 float64x2_t __s0_893 = __p0_893; \
68604 float64x2_t __s2_893 = __p2_893; \
68605 __ret_893 = vsetq_lane_f64(vgetq_lane_f64(__s2_893, __p3_893), __s0_893, __p1_893); \
68606 __ret_893; \
6919968607})
6920068608#else
69201#define vcopyq_laneq_f64(__p0_934, __p1_934, __p2_934, __p3_934) __extension__ ({ \
69202 float64x2_t __ret_934; \
69203 float64x2_t __s0_934 = __p0_934; \
69204 float64x2_t __s2_934 = __p2_934; \
69205 float64x2_t __rev0_934; __rev0_934 = __builtin_shufflevector(__s0_934, __s0_934, 1, 0); \
69206 float64x2_t __rev2_934; __rev2_934 = __builtin_shufflevector(__s2_934, __s2_934, 1, 0); \
69207 __ret_934 = __noswap_vsetq_lane_f64(__noswap_vgetq_lane_f64(__rev2_934, __p3_934), __rev0_934, __p1_934); \
69208 __ret_934 = __builtin_shufflevector(__ret_934, __ret_934, 1, 0); \
69209 __ret_934; \
68609#define vcopyq_laneq_f64(__p0_894, __p1_894, __p2_894, __p3_894) __extension__ ({ \
68610 float64x2_t __ret_894; \
68611 float64x2_t __s0_894 = __p0_894; \
68612 float64x2_t __s2_894 = __p2_894; \
68613 float64x2_t __rev0_894; __rev0_894 = __builtin_shufflevector(__s0_894, __s0_894, 1, 0); \
68614 float64x2_t __rev2_894; __rev2_894 = __builtin_shufflevector(__s2_894, __s2_894, 1, 0); \
68615 __ret_894 = __noswap_vsetq_lane_f64(__noswap_vgetq_lane_f64(__rev2_894, __p3_894), __rev0_894, __p1_894); \
68616 __ret_894 = __builtin_shufflevector(__ret_894, __ret_894, 1, 0); \
68617 __ret_894; \
6921068618})
6921168619#endif
6921268620
6921368621#ifdef __LITTLE_ENDIAN__
69214#define vcopy_laneq_p64(__p0_935, __p1_935, __p2_935, __p3_935) __extension__ ({ \
69215 poly64x1_t __ret_935; \
69216 poly64x1_t __s0_935 = __p0_935; \
69217 poly64x2_t __s2_935 = __p2_935; \
69218 __ret_935 = vset_lane_p64(vgetq_lane_p64(__s2_935, __p3_935), __s0_935, __p1_935); \
69219 __ret_935; \
68622#define vcopy_laneq_p64(__p0_895, __p1_895, __p2_895, __p3_895) __extension__ ({ \
68623 poly64x1_t __ret_895; \
68624 poly64x1_t __s0_895 = __p0_895; \
68625 poly64x2_t __s2_895 = __p2_895; \
68626 __ret_895 = vset_lane_p64(vgetq_lane_p64(__s2_895, __p3_895), __s0_895, __p1_895); \
68627 __ret_895; \
6922068628})
6922168629#else
69222#define vcopy_laneq_p64(__p0_936, __p1_936, __p2_936, __p3_936) __extension__ ({ \
69223 poly64x1_t __ret_936; \
69224 poly64x1_t __s0_936 = __p0_936; \
69225 poly64x2_t __s2_936 = __p2_936; \
69226 poly64x2_t __rev2_936; __rev2_936 = __builtin_shufflevector(__s2_936, __s2_936, 1, 0); \
69227 __ret_936 = vset_lane_p64(__noswap_vgetq_lane_p64(__rev2_936, __p3_936), __s0_936, __p1_936); \
69228 __ret_936; \
68630#define vcopy_laneq_p64(__p0_896, __p1_896, __p2_896, __p3_896) __extension__ ({ \
68631 poly64x1_t __ret_896; \
68632 poly64x1_t __s0_896 = __p0_896; \
68633 poly64x2_t __s2_896 = __p2_896; \
68634 poly64x2_t __rev2_896; __rev2_896 = __builtin_shufflevector(__s2_896, __s2_896, 1, 0); \
68635 __ret_896 = vset_lane_p64(__noswap_vgetq_lane_p64(__rev2_896, __p3_896), __s0_896, __p1_896); \
68636 __ret_896; \
6922968637})
6923068638#endif
6923168639
6923268640#ifdef __LITTLE_ENDIAN__
69233#define vcopy_laneq_f64(__p0_937, __p1_937, __p2_937, __p3_937) __extension__ ({ \
69234 float64x1_t __ret_937; \
69235 float64x1_t __s0_937 = __p0_937; \
69236 float64x2_t __s2_937 = __p2_937; \
69237 __ret_937 = vset_lane_f64(vgetq_lane_f64(__s2_937, __p3_937), __s0_937, __p1_937); \
69238 __ret_937; \
68641#define vcopy_laneq_f64(__p0_897, __p1_897, __p2_897, __p3_897) __extension__ ({ \
68642 float64x1_t __ret_897; \
68643 float64x1_t __s0_897 = __p0_897; \
68644 float64x2_t __s2_897 = __p2_897; \
68645 __ret_897 = vset_lane_f64(vgetq_lane_f64(__s2_897, __p3_897), __s0_897, __p1_897); \
68646 __ret_897; \
6923968647})
6924068648#else
69241#define vcopy_laneq_f64(__p0_938, __p1_938, __p2_938, __p3_938) __extension__ ({ \
69242 float64x1_t __ret_938; \
69243 float64x1_t __s0_938 = __p0_938; \
69244 float64x2_t __s2_938 = __p2_938; \
69245 float64x2_t __rev2_938; __rev2_938 = __builtin_shufflevector(__s2_938, __s2_938, 1, 0); \
69246 __ret_938 = vset_lane_f64(__noswap_vgetq_lane_f64(__rev2_938, __p3_938), __s0_938, __p1_938); \
69247 __ret_938; \
68649#define vcopy_laneq_f64(__p0_898, __p1_898, __p2_898, __p3_898) __extension__ ({ \
68650 float64x1_t __ret_898; \
68651 float64x1_t __s0_898 = __p0_898; \
68652 float64x2_t __s2_898 = __p2_898; \
68653 float64x2_t __rev2_898; __rev2_898 = __builtin_shufflevector(__s2_898, __s2_898, 1, 0); \
68654 __ret_898 = vset_lane_f64(__noswap_vgetq_lane_f64(__rev2_898, __p3_898), __s0_898, __p1_898); \
68655 __ret_898; \
6924868656})
6924968657#endif
6925068658
......@@ -69600,38 +69008,460 @@ __ai int32x4_t vmlsl_high_n_s16(int32x4_t __p0, int16x8_t __p1, int16_t __p2) {
6960069008}
6960169009#endif
6960269010
69603#define vmulx_lane_f64(__p0_939, __p1_939, __p2_939) __extension__ ({ \
69604 float64x1_t __ret_939; \
69605 float64x1_t __s0_939 = __p0_939; \
69606 float64x1_t __s1_939 = __p1_939; \
69607 float64_t __x_939 = vget_lane_f64(__s0_939, 0); \
69608 float64_t __y_939 = vget_lane_f64(__s1_939, __p2_939); \
69609 float64_t __z_939 = vmulxd_f64(__x_939, __y_939); \
69610 __ret_939 = vset_lane_f64(__z_939, __s0_939, __p2_939); \
69611 __ret_939; \
69011#define vmulx_lane_f64(__p0_899, __p1_899, __p2_899) __extension__ ({ \
69012 float64x1_t __ret_899; \
69013 float64x1_t __s0_899 = __p0_899; \
69014 float64x1_t __s1_899 = __p1_899; \
69015 float64_t __x_899 = vget_lane_f64(__s0_899, 0); \
69016 float64_t __y_899 = vget_lane_f64(__s1_899, __p2_899); \
69017 float64_t __z_899 = vmulxd_f64(__x_899, __y_899); \
69018 __ret_899 = vset_lane_f64(__z_899, __s0_899, __p2_899); \
69019 __ret_899; \
69020})
69021#ifdef __LITTLE_ENDIAN__
69022#define vmulx_laneq_f64(__p0_900, __p1_900, __p2_900) __extension__ ({ \
69023 float64x1_t __ret_900; \
69024 float64x1_t __s0_900 = __p0_900; \
69025 float64x2_t __s1_900 = __p1_900; \
69026 float64_t __x_900 = vget_lane_f64(__s0_900, 0); \
69027 float64_t __y_900 = vgetq_lane_f64(__s1_900, __p2_900); \
69028 float64_t __z_900 = vmulxd_f64(__x_900, __y_900); \
69029 __ret_900 = vset_lane_f64(__z_900, __s0_900, 0); \
69030 __ret_900; \
69031})
69032#else
69033#define vmulx_laneq_f64(__p0_901, __p1_901, __p2_901) __extension__ ({ \
69034 float64x1_t __ret_901; \
69035 float64x1_t __s0_901 = __p0_901; \
69036 float64x2_t __s1_901 = __p1_901; \
69037 float64x2_t __rev1_901; __rev1_901 = __builtin_shufflevector(__s1_901, __s1_901, 1, 0); \
69038 float64_t __x_901 = vget_lane_f64(__s0_901, 0); \
69039 float64_t __y_901 = __noswap_vgetq_lane_f64(__rev1_901, __p2_901); \
69040 float64_t __z_901 = vmulxd_f64(__x_901, __y_901); \
69041 __ret_901 = vset_lane_f64(__z_901, __s0_901, 0); \
69042 __ret_901; \
69043})
69044#endif
69045
69046#ifdef __LITTLE_ENDIAN__
69047#define vfmlalq_lane_high_f16(__p0_902, __p1_902, __p2_902, __p3_902) __extension__ ({ \
69048 float32x4_t __ret_902; \
69049 float32x4_t __s0_902 = __p0_902; \
69050 float16x8_t __s1_902 = __p1_902; \
69051 float16x4_t __s2_902 = __p2_902; \
69052 __ret_902 = vfmlalq_high_f16(__s0_902, __s1_902, (float16x8_t) {vget_lane_f16(__s2_902, __p3_902), vget_lane_f16(__s2_902, __p3_902), vget_lane_f16(__s2_902, __p3_902), vget_lane_f16(__s2_902, __p3_902), vget_lane_f16(__s2_902, __p3_902), vget_lane_f16(__s2_902, __p3_902), vget_lane_f16(__s2_902, __p3_902), vget_lane_f16(__s2_902, __p3_902)}); \
69053 __ret_902; \
69054})
69055#else
69056#define vfmlalq_lane_high_f16(__p0_903, __p1_903, __p2_903, __p3_903) __extension__ ({ \
69057 float32x4_t __ret_903; \
69058 float32x4_t __s0_903 = __p0_903; \
69059 float16x8_t __s1_903 = __p1_903; \
69060 float16x4_t __s2_903 = __p2_903; \
69061 float32x4_t __rev0_903; __rev0_903 = __builtin_shufflevector(__s0_903, __s0_903, 3, 2, 1, 0); \
69062 float16x8_t __rev1_903; __rev1_903 = __builtin_shufflevector(__s1_903, __s1_903, 7, 6, 5, 4, 3, 2, 1, 0); \
69063 float16x4_t __rev2_903; __rev2_903 = __builtin_shufflevector(__s2_903, __s2_903, 3, 2, 1, 0); \
69064 __ret_903 = __noswap_vfmlalq_high_f16(__rev0_903, __rev1_903, (float16x8_t) {__noswap_vget_lane_f16(__rev2_903, __p3_903), __noswap_vget_lane_f16(__rev2_903, __p3_903), __noswap_vget_lane_f16(__rev2_903, __p3_903), __noswap_vget_lane_f16(__rev2_903, __p3_903), __noswap_vget_lane_f16(__rev2_903, __p3_903), __noswap_vget_lane_f16(__rev2_903, __p3_903), __noswap_vget_lane_f16(__rev2_903, __p3_903), __noswap_vget_lane_f16(__rev2_903, __p3_903)}); \
69065 __ret_903 = __builtin_shufflevector(__ret_903, __ret_903, 3, 2, 1, 0); \
69066 __ret_903; \
69067})
69068#endif
69069
69070#ifdef __LITTLE_ENDIAN__
69071#define vfmlal_lane_high_f16(__p0_904, __p1_904, __p2_904, __p3_904) __extension__ ({ \
69072 float32x2_t __ret_904; \
69073 float32x2_t __s0_904 = __p0_904; \
69074 float16x4_t __s1_904 = __p1_904; \
69075 float16x4_t __s2_904 = __p2_904; \
69076 __ret_904 = vfmlal_high_f16(__s0_904, __s1_904, (float16x4_t) {vget_lane_f16(__s2_904, __p3_904), vget_lane_f16(__s2_904, __p3_904), vget_lane_f16(__s2_904, __p3_904), vget_lane_f16(__s2_904, __p3_904)}); \
69077 __ret_904; \
69078})
69079#else
69080#define vfmlal_lane_high_f16(__p0_905, __p1_905, __p2_905, __p3_905) __extension__ ({ \
69081 float32x2_t __ret_905; \
69082 float32x2_t __s0_905 = __p0_905; \
69083 float16x4_t __s1_905 = __p1_905; \
69084 float16x4_t __s2_905 = __p2_905; \
69085 float32x2_t __rev0_905; __rev0_905 = __builtin_shufflevector(__s0_905, __s0_905, 1, 0); \
69086 float16x4_t __rev1_905; __rev1_905 = __builtin_shufflevector(__s1_905, __s1_905, 3, 2, 1, 0); \
69087 float16x4_t __rev2_905; __rev2_905 = __builtin_shufflevector(__s2_905, __s2_905, 3, 2, 1, 0); \
69088 __ret_905 = __noswap_vfmlal_high_f16(__rev0_905, __rev1_905, (float16x4_t) {__noswap_vget_lane_f16(__rev2_905, __p3_905), __noswap_vget_lane_f16(__rev2_905, __p3_905), __noswap_vget_lane_f16(__rev2_905, __p3_905), __noswap_vget_lane_f16(__rev2_905, __p3_905)}); \
69089 __ret_905 = __builtin_shufflevector(__ret_905, __ret_905, 1, 0); \
69090 __ret_905; \
69091})
69092#endif
69093
69094#ifdef __LITTLE_ENDIAN__
69095#define vfmlalq_lane_low_f16(__p0_906, __p1_906, __p2_906, __p3_906) __extension__ ({ \
69096 float32x4_t __ret_906; \
69097 float32x4_t __s0_906 = __p0_906; \
69098 float16x8_t __s1_906 = __p1_906; \
69099 float16x4_t __s2_906 = __p2_906; \
69100 __ret_906 = vfmlalq_low_f16(__s0_906, __s1_906, (float16x8_t) {vget_lane_f16(__s2_906, __p3_906), vget_lane_f16(__s2_906, __p3_906), vget_lane_f16(__s2_906, __p3_906), vget_lane_f16(__s2_906, __p3_906), vget_lane_f16(__s2_906, __p3_906), vget_lane_f16(__s2_906, __p3_906), vget_lane_f16(__s2_906, __p3_906), vget_lane_f16(__s2_906, __p3_906)}); \
69101 __ret_906; \
69102})
69103#else
69104#define vfmlalq_lane_low_f16(__p0_907, __p1_907, __p2_907, __p3_907) __extension__ ({ \
69105 float32x4_t __ret_907; \
69106 float32x4_t __s0_907 = __p0_907; \
69107 float16x8_t __s1_907 = __p1_907; \
69108 float16x4_t __s2_907 = __p2_907; \
69109 float32x4_t __rev0_907; __rev0_907 = __builtin_shufflevector(__s0_907, __s0_907, 3, 2, 1, 0); \
69110 float16x8_t __rev1_907; __rev1_907 = __builtin_shufflevector(__s1_907, __s1_907, 7, 6, 5, 4, 3, 2, 1, 0); \
69111 float16x4_t __rev2_907; __rev2_907 = __builtin_shufflevector(__s2_907, __s2_907, 3, 2, 1, 0); \
69112 __ret_907 = __noswap_vfmlalq_low_f16(__rev0_907, __rev1_907, (float16x8_t) {__noswap_vget_lane_f16(__rev2_907, __p3_907), __noswap_vget_lane_f16(__rev2_907, __p3_907), __noswap_vget_lane_f16(__rev2_907, __p3_907), __noswap_vget_lane_f16(__rev2_907, __p3_907), __noswap_vget_lane_f16(__rev2_907, __p3_907), __noswap_vget_lane_f16(__rev2_907, __p3_907), __noswap_vget_lane_f16(__rev2_907, __p3_907), __noswap_vget_lane_f16(__rev2_907, __p3_907)}); \
69113 __ret_907 = __builtin_shufflevector(__ret_907, __ret_907, 3, 2, 1, 0); \
69114 __ret_907; \
69115})
69116#endif
69117
69118#ifdef __LITTLE_ENDIAN__
69119#define vfmlal_lane_low_f16(__p0_908, __p1_908, __p2_908, __p3_908) __extension__ ({ \
69120 float32x2_t __ret_908; \
69121 float32x2_t __s0_908 = __p0_908; \
69122 float16x4_t __s1_908 = __p1_908; \
69123 float16x4_t __s2_908 = __p2_908; \
69124 __ret_908 = vfmlal_low_f16(__s0_908, __s1_908, (float16x4_t) {vget_lane_f16(__s2_908, __p3_908), vget_lane_f16(__s2_908, __p3_908), vget_lane_f16(__s2_908, __p3_908), vget_lane_f16(__s2_908, __p3_908)}); \
69125 __ret_908; \
69126})
69127#else
69128#define vfmlal_lane_low_f16(__p0_909, __p1_909, __p2_909, __p3_909) __extension__ ({ \
69129 float32x2_t __ret_909; \
69130 float32x2_t __s0_909 = __p0_909; \
69131 float16x4_t __s1_909 = __p1_909; \
69132 float16x4_t __s2_909 = __p2_909; \
69133 float32x2_t __rev0_909; __rev0_909 = __builtin_shufflevector(__s0_909, __s0_909, 1, 0); \
69134 float16x4_t __rev1_909; __rev1_909 = __builtin_shufflevector(__s1_909, __s1_909, 3, 2, 1, 0); \
69135 float16x4_t __rev2_909; __rev2_909 = __builtin_shufflevector(__s2_909, __s2_909, 3, 2, 1, 0); \
69136 __ret_909 = __noswap_vfmlal_low_f16(__rev0_909, __rev1_909, (float16x4_t) {__noswap_vget_lane_f16(__rev2_909, __p3_909), __noswap_vget_lane_f16(__rev2_909, __p3_909), __noswap_vget_lane_f16(__rev2_909, __p3_909), __noswap_vget_lane_f16(__rev2_909, __p3_909)}); \
69137 __ret_909 = __builtin_shufflevector(__ret_909, __ret_909, 1, 0); \
69138 __ret_909; \
69139})
69140#endif
69141
69142#ifdef __LITTLE_ENDIAN__
69143#define vfmlalq_laneq_high_f16(__p0_910, __p1_910, __p2_910, __p3_910) __extension__ ({ \
69144 float32x4_t __ret_910; \
69145 float32x4_t __s0_910 = __p0_910; \
69146 float16x8_t __s1_910 = __p1_910; \
69147 float16x8_t __s2_910 = __p2_910; \
69148 __ret_910 = vfmlalq_high_f16(__s0_910, __s1_910, (float16x8_t) {vgetq_lane_f16(__s2_910, __p3_910), vgetq_lane_f16(__s2_910, __p3_910), vgetq_lane_f16(__s2_910, __p3_910), vgetq_lane_f16(__s2_910, __p3_910), vgetq_lane_f16(__s2_910, __p3_910), vgetq_lane_f16(__s2_910, __p3_910), vgetq_lane_f16(__s2_910, __p3_910), vgetq_lane_f16(__s2_910, __p3_910)}); \
69149 __ret_910; \
69150})
69151#else
69152#define vfmlalq_laneq_high_f16(__p0_911, __p1_911, __p2_911, __p3_911) __extension__ ({ \
69153 float32x4_t __ret_911; \
69154 float32x4_t __s0_911 = __p0_911; \
69155 float16x8_t __s1_911 = __p1_911; \
69156 float16x8_t __s2_911 = __p2_911; \
69157 float32x4_t __rev0_911; __rev0_911 = __builtin_shufflevector(__s0_911, __s0_911, 3, 2, 1, 0); \
69158 float16x8_t __rev1_911; __rev1_911 = __builtin_shufflevector(__s1_911, __s1_911, 7, 6, 5, 4, 3, 2, 1, 0); \
69159 float16x8_t __rev2_911; __rev2_911 = __builtin_shufflevector(__s2_911, __s2_911, 7, 6, 5, 4, 3, 2, 1, 0); \
69160 __ret_911 = __noswap_vfmlalq_high_f16(__rev0_911, __rev1_911, (float16x8_t) {__noswap_vgetq_lane_f16(__rev2_911, __p3_911), __noswap_vgetq_lane_f16(__rev2_911, __p3_911), __noswap_vgetq_lane_f16(__rev2_911, __p3_911), __noswap_vgetq_lane_f16(__rev2_911, __p3_911), __noswap_vgetq_lane_f16(__rev2_911, __p3_911), __noswap_vgetq_lane_f16(__rev2_911, __p3_911), __noswap_vgetq_lane_f16(__rev2_911, __p3_911), __noswap_vgetq_lane_f16(__rev2_911, __p3_911)}); \
69161 __ret_911 = __builtin_shufflevector(__ret_911, __ret_911, 3, 2, 1, 0); \
69162 __ret_911; \
6961269163})
69164#endif
69165
6961369166#ifdef __LITTLE_ENDIAN__
69614#define vmulx_laneq_f64(__p0_940, __p1_940, __p2_940) __extension__ ({ \
69615 float64x1_t __ret_940; \
69616 float64x1_t __s0_940 = __p0_940; \
69617 float64x2_t __s1_940 = __p1_940; \
69618 float64_t __x_940 = vget_lane_f64(__s0_940, 0); \
69619 float64_t __y_940 = vgetq_lane_f64(__s1_940, __p2_940); \
69620 float64_t __z_940 = vmulxd_f64(__x_940, __y_940); \
69621 __ret_940 = vset_lane_f64(__z_940, __s0_940, 0); \
69622 __ret_940; \
69167#define vfmlal_laneq_high_f16(__p0_912, __p1_912, __p2_912, __p3_912) __extension__ ({ \
69168 float32x2_t __ret_912; \
69169 float32x2_t __s0_912 = __p0_912; \
69170 float16x4_t __s1_912 = __p1_912; \
69171 float16x8_t __s2_912 = __p2_912; \
69172 __ret_912 = vfmlal_high_f16(__s0_912, __s1_912, (float16x4_t) {vgetq_lane_f16(__s2_912, __p3_912), vgetq_lane_f16(__s2_912, __p3_912), vgetq_lane_f16(__s2_912, __p3_912), vgetq_lane_f16(__s2_912, __p3_912)}); \
69173 __ret_912; \
6962369174})
6962469175#else
69625#define vmulx_laneq_f64(__p0_941, __p1_941, __p2_941) __extension__ ({ \
69626 float64x1_t __ret_941; \
69627 float64x1_t __s0_941 = __p0_941; \
69628 float64x2_t __s1_941 = __p1_941; \
69629 float64x2_t __rev1_941; __rev1_941 = __builtin_shufflevector(__s1_941, __s1_941, 1, 0); \
69630 float64_t __x_941 = vget_lane_f64(__s0_941, 0); \
69631 float64_t __y_941 = __noswap_vgetq_lane_f64(__rev1_941, __p2_941); \
69632 float64_t __z_941 = vmulxd_f64(__x_941, __y_941); \
69633 __ret_941 = vset_lane_f64(__z_941, __s0_941, 0); \
69634 __ret_941; \
69176#define vfmlal_laneq_high_f16(__p0_913, __p1_913, __p2_913, __p3_913) __extension__ ({ \
69177 float32x2_t __ret_913; \
69178 float32x2_t __s0_913 = __p0_913; \
69179 float16x4_t __s1_913 = __p1_913; \
69180 float16x8_t __s2_913 = __p2_913; \
69181 float32x2_t __rev0_913; __rev0_913 = __builtin_shufflevector(__s0_913, __s0_913, 1, 0); \
69182 float16x4_t __rev1_913; __rev1_913 = __builtin_shufflevector(__s1_913, __s1_913, 3, 2, 1, 0); \
69183 float16x8_t __rev2_913; __rev2_913 = __builtin_shufflevector(__s2_913, __s2_913, 7, 6, 5, 4, 3, 2, 1, 0); \
69184 __ret_913 = __noswap_vfmlal_high_f16(__rev0_913, __rev1_913, (float16x4_t) {__noswap_vgetq_lane_f16(__rev2_913, __p3_913), __noswap_vgetq_lane_f16(__rev2_913, __p3_913), __noswap_vgetq_lane_f16(__rev2_913, __p3_913), __noswap_vgetq_lane_f16(__rev2_913, __p3_913)}); \
69185 __ret_913 = __builtin_shufflevector(__ret_913, __ret_913, 1, 0); \
69186 __ret_913; \
69187})
69188#endif
69189
69190#ifdef __LITTLE_ENDIAN__
69191#define vfmlalq_laneq_low_f16(__p0_914, __p1_914, __p2_914, __p3_914) __extension__ ({ \
69192 float32x4_t __ret_914; \
69193 float32x4_t __s0_914 = __p0_914; \
69194 float16x8_t __s1_914 = __p1_914; \
69195 float16x8_t __s2_914 = __p2_914; \
69196 __ret_914 = vfmlalq_low_f16(__s0_914, __s1_914, (float16x8_t) {vgetq_lane_f16(__s2_914, __p3_914), vgetq_lane_f16(__s2_914, __p3_914), vgetq_lane_f16(__s2_914, __p3_914), vgetq_lane_f16(__s2_914, __p3_914), vgetq_lane_f16(__s2_914, __p3_914), vgetq_lane_f16(__s2_914, __p3_914), vgetq_lane_f16(__s2_914, __p3_914), vgetq_lane_f16(__s2_914, __p3_914)}); \
69197 __ret_914; \
69198})
69199#else
69200#define vfmlalq_laneq_low_f16(__p0_915, __p1_915, __p2_915, __p3_915) __extension__ ({ \
69201 float32x4_t __ret_915; \
69202 float32x4_t __s0_915 = __p0_915; \
69203 float16x8_t __s1_915 = __p1_915; \
69204 float16x8_t __s2_915 = __p2_915; \
69205 float32x4_t __rev0_915; __rev0_915 = __builtin_shufflevector(__s0_915, __s0_915, 3, 2, 1, 0); \
69206 float16x8_t __rev1_915; __rev1_915 = __builtin_shufflevector(__s1_915, __s1_915, 7, 6, 5, 4, 3, 2, 1, 0); \
69207 float16x8_t __rev2_915; __rev2_915 = __builtin_shufflevector(__s2_915, __s2_915, 7, 6, 5, 4, 3, 2, 1, 0); \
69208 __ret_915 = __noswap_vfmlalq_low_f16(__rev0_915, __rev1_915, (float16x8_t) {__noswap_vgetq_lane_f16(__rev2_915, __p3_915), __noswap_vgetq_lane_f16(__rev2_915, __p3_915), __noswap_vgetq_lane_f16(__rev2_915, __p3_915), __noswap_vgetq_lane_f16(__rev2_915, __p3_915), __noswap_vgetq_lane_f16(__rev2_915, __p3_915), __noswap_vgetq_lane_f16(__rev2_915, __p3_915), __noswap_vgetq_lane_f16(__rev2_915, __p3_915), __noswap_vgetq_lane_f16(__rev2_915, __p3_915)}); \
69209 __ret_915 = __builtin_shufflevector(__ret_915, __ret_915, 3, 2, 1, 0); \
69210 __ret_915; \
69211})
69212#endif
69213
69214#ifdef __LITTLE_ENDIAN__
69215#define vfmlal_laneq_low_f16(__p0_916, __p1_916, __p2_916, __p3_916) __extension__ ({ \
69216 float32x2_t __ret_916; \
69217 float32x2_t __s0_916 = __p0_916; \
69218 float16x4_t __s1_916 = __p1_916; \
69219 float16x8_t __s2_916 = __p2_916; \
69220 __ret_916 = vfmlal_low_f16(__s0_916, __s1_916, (float16x4_t) {vgetq_lane_f16(__s2_916, __p3_916), vgetq_lane_f16(__s2_916, __p3_916), vgetq_lane_f16(__s2_916, __p3_916), vgetq_lane_f16(__s2_916, __p3_916)}); \
69221 __ret_916; \
69222})
69223#else
69224#define vfmlal_laneq_low_f16(__p0_917, __p1_917, __p2_917, __p3_917) __extension__ ({ \
69225 float32x2_t __ret_917; \
69226 float32x2_t __s0_917 = __p0_917; \
69227 float16x4_t __s1_917 = __p1_917; \
69228 float16x8_t __s2_917 = __p2_917; \
69229 float32x2_t __rev0_917; __rev0_917 = __builtin_shufflevector(__s0_917, __s0_917, 1, 0); \
69230 float16x4_t __rev1_917; __rev1_917 = __builtin_shufflevector(__s1_917, __s1_917, 3, 2, 1, 0); \
69231 float16x8_t __rev2_917; __rev2_917 = __builtin_shufflevector(__s2_917, __s2_917, 7, 6, 5, 4, 3, 2, 1, 0); \
69232 __ret_917 = __noswap_vfmlal_low_f16(__rev0_917, __rev1_917, (float16x4_t) {__noswap_vgetq_lane_f16(__rev2_917, __p3_917), __noswap_vgetq_lane_f16(__rev2_917, __p3_917), __noswap_vgetq_lane_f16(__rev2_917, __p3_917), __noswap_vgetq_lane_f16(__rev2_917, __p3_917)}); \
69233 __ret_917 = __builtin_shufflevector(__ret_917, __ret_917, 1, 0); \
69234 __ret_917; \
69235})
69236#endif
69237
69238#ifdef __LITTLE_ENDIAN__
69239#define vfmlslq_lane_high_f16(__p0_918, __p1_918, __p2_918, __p3_918) __extension__ ({ \
69240 float32x4_t __ret_918; \
69241 float32x4_t __s0_918 = __p0_918; \
69242 float16x8_t __s1_918 = __p1_918; \
69243 float16x4_t __s2_918 = __p2_918; \
69244 __ret_918 = vfmlslq_high_f16(__s0_918, __s1_918, (float16x8_t) {vget_lane_f16(__s2_918, __p3_918), vget_lane_f16(__s2_918, __p3_918), vget_lane_f16(__s2_918, __p3_918), vget_lane_f16(__s2_918, __p3_918), vget_lane_f16(__s2_918, __p3_918), vget_lane_f16(__s2_918, __p3_918), vget_lane_f16(__s2_918, __p3_918), vget_lane_f16(__s2_918, __p3_918)}); \
69245 __ret_918; \
69246})
69247#else
69248#define vfmlslq_lane_high_f16(__p0_919, __p1_919, __p2_919, __p3_919) __extension__ ({ \
69249 float32x4_t __ret_919; \
69250 float32x4_t __s0_919 = __p0_919; \
69251 float16x8_t __s1_919 = __p1_919; \
69252 float16x4_t __s2_919 = __p2_919; \
69253 float32x4_t __rev0_919; __rev0_919 = __builtin_shufflevector(__s0_919, __s0_919, 3, 2, 1, 0); \
69254 float16x8_t __rev1_919; __rev1_919 = __builtin_shufflevector(__s1_919, __s1_919, 7, 6, 5, 4, 3, 2, 1, 0); \
69255 float16x4_t __rev2_919; __rev2_919 = __builtin_shufflevector(__s2_919, __s2_919, 3, 2, 1, 0); \
69256 __ret_919 = __noswap_vfmlslq_high_f16(__rev0_919, __rev1_919, (float16x8_t) {__noswap_vget_lane_f16(__rev2_919, __p3_919), __noswap_vget_lane_f16(__rev2_919, __p3_919), __noswap_vget_lane_f16(__rev2_919, __p3_919), __noswap_vget_lane_f16(__rev2_919, __p3_919), __noswap_vget_lane_f16(__rev2_919, __p3_919), __noswap_vget_lane_f16(__rev2_919, __p3_919), __noswap_vget_lane_f16(__rev2_919, __p3_919), __noswap_vget_lane_f16(__rev2_919, __p3_919)}); \
69257 __ret_919 = __builtin_shufflevector(__ret_919, __ret_919, 3, 2, 1, 0); \
69258 __ret_919; \
69259})
69260#endif
69261
69262#ifdef __LITTLE_ENDIAN__
69263#define vfmlsl_lane_high_f16(__p0_920, __p1_920, __p2_920, __p3_920) __extension__ ({ \
69264 float32x2_t __ret_920; \
69265 float32x2_t __s0_920 = __p0_920; \
69266 float16x4_t __s1_920 = __p1_920; \
69267 float16x4_t __s2_920 = __p2_920; \
69268 __ret_920 = vfmlsl_high_f16(__s0_920, __s1_920, (float16x4_t) {vget_lane_f16(__s2_920, __p3_920), vget_lane_f16(__s2_920, __p3_920), vget_lane_f16(__s2_920, __p3_920), vget_lane_f16(__s2_920, __p3_920)}); \
69269 __ret_920; \
69270})
69271#else
69272#define vfmlsl_lane_high_f16(__p0_921, __p1_921, __p2_921, __p3_921) __extension__ ({ \
69273 float32x2_t __ret_921; \
69274 float32x2_t __s0_921 = __p0_921; \
69275 float16x4_t __s1_921 = __p1_921; \
69276 float16x4_t __s2_921 = __p2_921; \
69277 float32x2_t __rev0_921; __rev0_921 = __builtin_shufflevector(__s0_921, __s0_921, 1, 0); \
69278 float16x4_t __rev1_921; __rev1_921 = __builtin_shufflevector(__s1_921, __s1_921, 3, 2, 1, 0); \
69279 float16x4_t __rev2_921; __rev2_921 = __builtin_shufflevector(__s2_921, __s2_921, 3, 2, 1, 0); \
69280 __ret_921 = __noswap_vfmlsl_high_f16(__rev0_921, __rev1_921, (float16x4_t) {__noswap_vget_lane_f16(__rev2_921, __p3_921), __noswap_vget_lane_f16(__rev2_921, __p3_921), __noswap_vget_lane_f16(__rev2_921, __p3_921), __noswap_vget_lane_f16(__rev2_921, __p3_921)}); \
69281 __ret_921 = __builtin_shufflevector(__ret_921, __ret_921, 1, 0); \
69282 __ret_921; \
69283})
69284#endif
69285
69286#ifdef __LITTLE_ENDIAN__
69287#define vfmlslq_lane_low_f16(__p0_922, __p1_922, __p2_922, __p3_922) __extension__ ({ \
69288 float32x4_t __ret_922; \
69289 float32x4_t __s0_922 = __p0_922; \
69290 float16x8_t __s1_922 = __p1_922; \
69291 float16x4_t __s2_922 = __p2_922; \
69292 __ret_922 = vfmlslq_low_f16(__s0_922, __s1_922, (float16x8_t) {vget_lane_f16(__s2_922, __p3_922), vget_lane_f16(__s2_922, __p3_922), vget_lane_f16(__s2_922, __p3_922), vget_lane_f16(__s2_922, __p3_922), vget_lane_f16(__s2_922, __p3_922), vget_lane_f16(__s2_922, __p3_922), vget_lane_f16(__s2_922, __p3_922), vget_lane_f16(__s2_922, __p3_922)}); \
69293 __ret_922; \
69294})
69295#else
69296#define vfmlslq_lane_low_f16(__p0_923, __p1_923, __p2_923, __p3_923) __extension__ ({ \
69297 float32x4_t __ret_923; \
69298 float32x4_t __s0_923 = __p0_923; \
69299 float16x8_t __s1_923 = __p1_923; \
69300 float16x4_t __s2_923 = __p2_923; \
69301 float32x4_t __rev0_923; __rev0_923 = __builtin_shufflevector(__s0_923, __s0_923, 3, 2, 1, 0); \
69302 float16x8_t __rev1_923; __rev1_923 = __builtin_shufflevector(__s1_923, __s1_923, 7, 6, 5, 4, 3, 2, 1, 0); \
69303 float16x4_t __rev2_923; __rev2_923 = __builtin_shufflevector(__s2_923, __s2_923, 3, 2, 1, 0); \
69304 __ret_923 = __noswap_vfmlslq_low_f16(__rev0_923, __rev1_923, (float16x8_t) {__noswap_vget_lane_f16(__rev2_923, __p3_923), __noswap_vget_lane_f16(__rev2_923, __p3_923), __noswap_vget_lane_f16(__rev2_923, __p3_923), __noswap_vget_lane_f16(__rev2_923, __p3_923), __noswap_vget_lane_f16(__rev2_923, __p3_923), __noswap_vget_lane_f16(__rev2_923, __p3_923), __noswap_vget_lane_f16(__rev2_923, __p3_923), __noswap_vget_lane_f16(__rev2_923, __p3_923)}); \
69305 __ret_923 = __builtin_shufflevector(__ret_923, __ret_923, 3, 2, 1, 0); \
69306 __ret_923; \
69307})
69308#endif
69309
69310#ifdef __LITTLE_ENDIAN__
69311#define vfmlsl_lane_low_f16(__p0_924, __p1_924, __p2_924, __p3_924) __extension__ ({ \
69312 float32x2_t __ret_924; \
69313 float32x2_t __s0_924 = __p0_924; \
69314 float16x4_t __s1_924 = __p1_924; \
69315 float16x4_t __s2_924 = __p2_924; \
69316 __ret_924 = vfmlsl_low_f16(__s0_924, __s1_924, (float16x4_t) {vget_lane_f16(__s2_924, __p3_924), vget_lane_f16(__s2_924, __p3_924), vget_lane_f16(__s2_924, __p3_924), vget_lane_f16(__s2_924, __p3_924)}); \
69317 __ret_924; \
69318})
69319#else
69320#define vfmlsl_lane_low_f16(__p0_925, __p1_925, __p2_925, __p3_925) __extension__ ({ \
69321 float32x2_t __ret_925; \
69322 float32x2_t __s0_925 = __p0_925; \
69323 float16x4_t __s1_925 = __p1_925; \
69324 float16x4_t __s2_925 = __p2_925; \
69325 float32x2_t __rev0_925; __rev0_925 = __builtin_shufflevector(__s0_925, __s0_925, 1, 0); \
69326 float16x4_t __rev1_925; __rev1_925 = __builtin_shufflevector(__s1_925, __s1_925, 3, 2, 1, 0); \
69327 float16x4_t __rev2_925; __rev2_925 = __builtin_shufflevector(__s2_925, __s2_925, 3, 2, 1, 0); \
69328 __ret_925 = __noswap_vfmlsl_low_f16(__rev0_925, __rev1_925, (float16x4_t) {__noswap_vget_lane_f16(__rev2_925, __p3_925), __noswap_vget_lane_f16(__rev2_925, __p3_925), __noswap_vget_lane_f16(__rev2_925, __p3_925), __noswap_vget_lane_f16(__rev2_925, __p3_925)}); \
69329 __ret_925 = __builtin_shufflevector(__ret_925, __ret_925, 1, 0); \
69330 __ret_925; \
69331})
69332#endif
69333
69334#ifdef __LITTLE_ENDIAN__
69335#define vfmlslq_laneq_high_f16(__p0_926, __p1_926, __p2_926, __p3_926) __extension__ ({ \
69336 float32x4_t __ret_926; \
69337 float32x4_t __s0_926 = __p0_926; \
69338 float16x8_t __s1_926 = __p1_926; \
69339 float16x8_t __s2_926 = __p2_926; \
69340 __ret_926 = vfmlslq_high_f16(__s0_926, __s1_926, (float16x8_t) {vgetq_lane_f16(__s2_926, __p3_926), vgetq_lane_f16(__s2_926, __p3_926), vgetq_lane_f16(__s2_926, __p3_926), vgetq_lane_f16(__s2_926, __p3_926), vgetq_lane_f16(__s2_926, __p3_926), vgetq_lane_f16(__s2_926, __p3_926), vgetq_lane_f16(__s2_926, __p3_926), vgetq_lane_f16(__s2_926, __p3_926)}); \
69341 __ret_926; \
69342})
69343#else
69344#define vfmlslq_laneq_high_f16(__p0_927, __p1_927, __p2_927, __p3_927) __extension__ ({ \
69345 float32x4_t __ret_927; \
69346 float32x4_t __s0_927 = __p0_927; \
69347 float16x8_t __s1_927 = __p1_927; \
69348 float16x8_t __s2_927 = __p2_927; \
69349 float32x4_t __rev0_927; __rev0_927 = __builtin_shufflevector(__s0_927, __s0_927, 3, 2, 1, 0); \
69350 float16x8_t __rev1_927; __rev1_927 = __builtin_shufflevector(__s1_927, __s1_927, 7, 6, 5, 4, 3, 2, 1, 0); \
69351 float16x8_t __rev2_927; __rev2_927 = __builtin_shufflevector(__s2_927, __s2_927, 7, 6, 5, 4, 3, 2, 1, 0); \
69352 __ret_927 = __noswap_vfmlslq_high_f16(__rev0_927, __rev1_927, (float16x8_t) {__noswap_vgetq_lane_f16(__rev2_927, __p3_927), __noswap_vgetq_lane_f16(__rev2_927, __p3_927), __noswap_vgetq_lane_f16(__rev2_927, __p3_927), __noswap_vgetq_lane_f16(__rev2_927, __p3_927), __noswap_vgetq_lane_f16(__rev2_927, __p3_927), __noswap_vgetq_lane_f16(__rev2_927, __p3_927), __noswap_vgetq_lane_f16(__rev2_927, __p3_927), __noswap_vgetq_lane_f16(__rev2_927, __p3_927)}); \
69353 __ret_927 = __builtin_shufflevector(__ret_927, __ret_927, 3, 2, 1, 0); \
69354 __ret_927; \
69355})
69356#endif
69357
69358#ifdef __LITTLE_ENDIAN__
69359#define vfmlsl_laneq_high_f16(__p0_928, __p1_928, __p2_928, __p3_928) __extension__ ({ \
69360 float32x2_t __ret_928; \
69361 float32x2_t __s0_928 = __p0_928; \
69362 float16x4_t __s1_928 = __p1_928; \
69363 float16x8_t __s2_928 = __p2_928; \
69364 __ret_928 = vfmlsl_high_f16(__s0_928, __s1_928, (float16x4_t) {vgetq_lane_f16(__s2_928, __p3_928), vgetq_lane_f16(__s2_928, __p3_928), vgetq_lane_f16(__s2_928, __p3_928), vgetq_lane_f16(__s2_928, __p3_928)}); \
69365 __ret_928; \
69366})
69367#else
69368#define vfmlsl_laneq_high_f16(__p0_929, __p1_929, __p2_929, __p3_929) __extension__ ({ \
69369 float32x2_t __ret_929; \
69370 float32x2_t __s0_929 = __p0_929; \
69371 float16x4_t __s1_929 = __p1_929; \
69372 float16x8_t __s2_929 = __p2_929; \
69373 float32x2_t __rev0_929; __rev0_929 = __builtin_shufflevector(__s0_929, __s0_929, 1, 0); \
69374 float16x4_t __rev1_929; __rev1_929 = __builtin_shufflevector(__s1_929, __s1_929, 3, 2, 1, 0); \
69375 float16x8_t __rev2_929; __rev2_929 = __builtin_shufflevector(__s2_929, __s2_929, 7, 6, 5, 4, 3, 2, 1, 0); \
69376 __ret_929 = __noswap_vfmlsl_high_f16(__rev0_929, __rev1_929, (float16x4_t) {__noswap_vgetq_lane_f16(__rev2_929, __p3_929), __noswap_vgetq_lane_f16(__rev2_929, __p3_929), __noswap_vgetq_lane_f16(__rev2_929, __p3_929), __noswap_vgetq_lane_f16(__rev2_929, __p3_929)}); \
69377 __ret_929 = __builtin_shufflevector(__ret_929, __ret_929, 1, 0); \
69378 __ret_929; \
69379})
69380#endif
69381
69382#ifdef __LITTLE_ENDIAN__
69383#define vfmlslq_laneq_low_f16(__p0_930, __p1_930, __p2_930, __p3_930) __extension__ ({ \
69384 float32x4_t __ret_930; \
69385 float32x4_t __s0_930 = __p0_930; \
69386 float16x8_t __s1_930 = __p1_930; \
69387 float16x8_t __s2_930 = __p2_930; \
69388 __ret_930 = vfmlslq_low_f16(__s0_930, __s1_930, (float16x8_t) {vgetq_lane_f16(__s2_930, __p3_930), vgetq_lane_f16(__s2_930, __p3_930), vgetq_lane_f16(__s2_930, __p3_930), vgetq_lane_f16(__s2_930, __p3_930), vgetq_lane_f16(__s2_930, __p3_930), vgetq_lane_f16(__s2_930, __p3_930), vgetq_lane_f16(__s2_930, __p3_930), vgetq_lane_f16(__s2_930, __p3_930)}); \
69389 __ret_930; \
69390})
69391#else
69392#define vfmlslq_laneq_low_f16(__p0_931, __p1_931, __p2_931, __p3_931) __extension__ ({ \
69393 float32x4_t __ret_931; \
69394 float32x4_t __s0_931 = __p0_931; \
69395 float16x8_t __s1_931 = __p1_931; \
69396 float16x8_t __s2_931 = __p2_931; \
69397 float32x4_t __rev0_931; __rev0_931 = __builtin_shufflevector(__s0_931, __s0_931, 3, 2, 1, 0); \
69398 float16x8_t __rev1_931; __rev1_931 = __builtin_shufflevector(__s1_931, __s1_931, 7, 6, 5, 4, 3, 2, 1, 0); \
69399 float16x8_t __rev2_931; __rev2_931 = __builtin_shufflevector(__s2_931, __s2_931, 7, 6, 5, 4, 3, 2, 1, 0); \
69400 __ret_931 = __noswap_vfmlslq_low_f16(__rev0_931, __rev1_931, (float16x8_t) {__noswap_vgetq_lane_f16(__rev2_931, __p3_931), __noswap_vgetq_lane_f16(__rev2_931, __p3_931), __noswap_vgetq_lane_f16(__rev2_931, __p3_931), __noswap_vgetq_lane_f16(__rev2_931, __p3_931), __noswap_vgetq_lane_f16(__rev2_931, __p3_931), __noswap_vgetq_lane_f16(__rev2_931, __p3_931), __noswap_vgetq_lane_f16(__rev2_931, __p3_931), __noswap_vgetq_lane_f16(__rev2_931, __p3_931)}); \
69401 __ret_931 = __builtin_shufflevector(__ret_931, __ret_931, 3, 2, 1, 0); \
69402 __ret_931; \
69403})
69404#endif
69405
69406#ifdef __LITTLE_ENDIAN__
69407#define vfmlsl_laneq_low_f16(__p0_932, __p1_932, __p2_932, __p3_932) __extension__ ({ \
69408 float32x2_t __ret_932; \
69409 float32x2_t __s0_932 = __p0_932; \
69410 float16x4_t __s1_932 = __p1_932; \
69411 float16x8_t __s2_932 = __p2_932; \
69412 __ret_932 = vfmlsl_low_f16(__s0_932, __s1_932, (float16x4_t) {vgetq_lane_f16(__s2_932, __p3_932), vgetq_lane_f16(__s2_932, __p3_932), vgetq_lane_f16(__s2_932, __p3_932), vgetq_lane_f16(__s2_932, __p3_932)}); \
69413 __ret_932; \
69414})
69415#else
69416#define vfmlsl_laneq_low_f16(__p0_933, __p1_933, __p2_933, __p3_933) __extension__ ({ \
69417 float32x2_t __ret_933; \
69418 float32x2_t __s0_933 = __p0_933; \
69419 float16x4_t __s1_933 = __p1_933; \
69420 float16x8_t __s2_933 = __p2_933; \
69421 float32x2_t __rev0_933; __rev0_933 = __builtin_shufflevector(__s0_933, __s0_933, 1, 0); \
69422 float16x4_t __rev1_933; __rev1_933 = __builtin_shufflevector(__s1_933, __s1_933, 3, 2, 1, 0); \
69423 float16x8_t __rev2_933; __rev2_933 = __builtin_shufflevector(__s2_933, __s2_933, 7, 6, 5, 4, 3, 2, 1, 0); \
69424 __ret_933 = __noswap_vfmlsl_low_f16(__rev0_933, __rev1_933, (float16x4_t) {__noswap_vgetq_lane_f16(__rev2_933, __p3_933), __noswap_vgetq_lane_f16(__rev2_933, __p3_933), __noswap_vgetq_lane_f16(__rev2_933, __p3_933), __noswap_vgetq_lane_f16(__rev2_933, __p3_933)}); \
69425 __ret_933 = __builtin_shufflevector(__ret_933, __ret_933, 1, 0); \
69426 __ret_933; \
69427})
69428#endif
69429
69430#ifdef __LITTLE_ENDIAN__
69431#define vmulh_lane_f16(__p0_934, __p1_934, __p2_934) __extension__ ({ \
69432 float16_t __ret_934; \
69433 float16_t __s0_934 = __p0_934; \
69434 float16x4_t __s1_934 = __p1_934; \
69435 __ret_934 = __s0_934 * vget_lane_f16(__s1_934, __p2_934); \
69436 __ret_934; \
69437})
69438#else
69439#define vmulh_lane_f16(__p0_935, __p1_935, __p2_935) __extension__ ({ \
69440 float16_t __ret_935; \
69441 float16_t __s0_935 = __p0_935; \
69442 float16x4_t __s1_935 = __p1_935; \
69443 float16x4_t __rev1_935; __rev1_935 = __builtin_shufflevector(__s1_935, __s1_935, 3, 2, 1, 0); \
69444 __ret_935 = __s0_935 * __noswap_vget_lane_f16(__rev1_935, __p2_935); \
69445 __ret_935; \
69446})
69447#endif
69448
69449#ifdef __LITTLE_ENDIAN__
69450#define vmulh_laneq_f16(__p0_936, __p1_936, __p2_936) __extension__ ({ \
69451 float16_t __ret_936; \
69452 float16_t __s0_936 = __p0_936; \
69453 float16x8_t __s1_936 = __p1_936; \
69454 __ret_936 = __s0_936 * vgetq_lane_f16(__s1_936, __p2_936); \
69455 __ret_936; \
69456})
69457#else
69458#define vmulh_laneq_f16(__p0_937, __p1_937, __p2_937) __extension__ ({ \
69459 float16_t __ret_937; \
69460 float16_t __s0_937 = __p0_937; \
69461 float16x8_t __s1_937 = __p1_937; \
69462 float16x8_t __rev1_937; __rev1_937 = __builtin_shufflevector(__s1_937, __s1_937, 7, 6, 5, 4, 3, 2, 1, 0); \
69463 __ret_937 = __s0_937 * __noswap_vgetq_lane_f16(__rev1_937, __p2_937); \
69464 __ret_937; \
6963569465})
6963669466#endif
6963769467
lib/include/arm_neon_sve_bridge.h created+182
......@@ -0,0 +1,182 @@
1/*===---- arm_neon_sve_bridge.h - ARM NEON SVE Bridge intrinsics -----------===
2 *
3 *
4 * Part of the LLVM Project, under the Apache License v2.0 with LLVM Exceptions.
5 * See https://llvm.org/LICENSE.txt for license information.
6 * SPDX-License-Identifier: Apache-2.0 WITH LLVM-exception
7 *
8 *===-----------------------------------------------------------------------===
9 */
10
11#ifndef __ARM_NEON_SVE_BRIDGE_H
12#define __ARM_NEON_SVE_BRIDGE_H
13
14#include <arm_neon.h>
15#include <arm_sve.h>
16
17#ifdef __cplusplus
18extern "C" {
19#endif
20
21/* Function attributes */
22#define __ai static __inline__ __attribute__((__always_inline__, __nodebug__))
23#define __aio \
24 static __inline__ \
25 __attribute__((__always_inline__, __nodebug__, __overloadable__))
26
27__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svset_neonq_s8)))
28svint8_t svset_neonq(svint8_t, int8x16_t);
29__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svset_neonq_s16)))
30svint16_t svset_neonq(svint16_t, int16x8_t);
31__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svset_neonq_s32)))
32svint32_t svset_neonq(svint32_t, int32x4_t);
33__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svset_neonq_s64)))
34svint64_t svset_neonq(svint64_t, int64x2_t);
35__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svset_neonq_u8)))
36svuint8_t svset_neonq(svuint8_t, uint8x16_t);
37__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svset_neonq_u16)))
38svuint16_t svset_neonq(svuint16_t, uint16x8_t);
39__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svset_neonq_u32)))
40svuint32_t svset_neonq(svuint32_t, uint32x4_t);
41__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svset_neonq_u64)))
42svuint64_t svset_neonq(svuint64_t, uint64x2_t);
43__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svset_neonq_f16)))
44svfloat16_t svset_neonq(svfloat16_t, float16x8_t);
45__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svset_neonq_f32)))
46svfloat32_t svset_neonq(svfloat32_t, float32x4_t);
47__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svset_neonq_f64)))
48svfloat64_t svset_neonq(svfloat64_t, float64x2_t);
49__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svset_neonq_s8)))
50svint8_t svset_neonq_s8(svint8_t, int8x16_t);
51__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svset_neonq_s16)))
52svint16_t svset_neonq_s16(svint16_t, int16x8_t);
53__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svset_neonq_s32)))
54svint32_t svset_neonq_s32(svint32_t, int32x4_t);
55__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svset_neonq_s64)))
56svint64_t svset_neonq_s64(svint64_t, int64x2_t);
57__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svset_neonq_u8)))
58svuint8_t svset_neonq_u8(svuint8_t, uint8x16_t);
59__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svset_neonq_u16)))
60svuint16_t svset_neonq_u16(svuint16_t, uint16x8_t);
61__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svset_neonq_u32)))
62svuint32_t svset_neonq_u32(svuint32_t, uint32x4_t);
63__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svset_neonq_u64)))
64svuint64_t svset_neonq_u64(svuint64_t, uint64x2_t);
65__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svset_neonq_f16)))
66svfloat16_t svset_neonq_f16(svfloat16_t, float16x8_t);
67__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svset_neonq_f32)))
68svfloat32_t svset_neonq_f32(svfloat32_t, float32x4_t);
69__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svset_neonq_f64)))
70svfloat64_t svset_neonq_f64(svfloat64_t, float64x2_t);
71
72__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svget_neonq_s8)))
73int8x16_t svget_neonq(svint8_t);
74__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svget_neonq_s16)))
75int16x8_t svget_neonq(svint16_t);
76__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svget_neonq_s32)))
77int32x4_t svget_neonq(svint32_t);
78__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svget_neonq_s64)))
79int64x2_t svget_neonq(svint64_t);
80__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svget_neonq_u8)))
81uint8x16_t svget_neonq(svuint8_t);
82__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svget_neonq_u16)))
83uint16x8_t svget_neonq(svuint16_t);
84__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svget_neonq_u32)))
85uint32x4_t svget_neonq(svuint32_t);
86__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svget_neonq_u64)))
87uint64x2_t svget_neonq(svuint64_t);
88__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svget_neonq_f16)))
89float16x8_t svget_neonq(svfloat16_t);
90__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svget_neonq_f32)))
91float32x4_t svget_neonq(svfloat32_t);
92__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svget_neonq_f64)))
93float64x2_t svget_neonq(svfloat64_t);
94__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svget_neonq_s8)))
95int8x16_t svget_neonq_s8(svint8_t);
96__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svget_neonq_s16)))
97int16x8_t svget_neonq_s16(svint16_t);
98__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svget_neonq_s32)))
99int32x4_t svget_neonq_s32(svint32_t);
100__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svget_neonq_s64)))
101int64x2_t svget_neonq_s64(svint64_t);
102__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svget_neonq_u8)))
103uint8x16_t svget_neonq_u8(svuint8_t);
104__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svget_neonq_u16)))
105uint16x8_t svget_neonq_u16(svuint16_t);
106__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svget_neonq_u32)))
107uint32x4_t svget_neonq_u32(svuint32_t);
108__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svget_neonq_u64)))
109uint64x2_t svget_neonq_u64(svuint64_t);
110__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svget_neonq_f16)))
111float16x8_t svget_neonq_f16(svfloat16_t);
112__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svget_neonq_f32)))
113float32x4_t svget_neonq_f32(svfloat32_t);
114__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svget_neonq_f64)))
115float64x2_t svget_neonq_f64(svfloat64_t);
116
117__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svdup_neonq_s8)))
118svint8_t svdup_neonq(int8x16_t);
119__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svdup_neonq_s16)))
120svint16_t svdup_neonq(int16x8_t);
121__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svdup_neonq_s32)))
122svint32_t svdup_neonq(int32x4_t);
123__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svdup_neonq_s64)))
124svint64_t svdup_neonq(int64x2_t);
125__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svdup_neonq_u8)))
126svuint8_t svdup_neonq(uint8x16_t);
127__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svdup_neonq_u16)))
128svuint16_t svdup_neonq(uint16x8_t);
129__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svdup_neonq_u32)))
130svuint32_t svdup_neonq(uint32x4_t);
131__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svdup_neonq_u64)))
132svuint64_t svdup_neonq(uint64x2_t);
133__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svdup_neonq_f16)))
134svfloat16_t svdup_neonq(float16x8_t);
135__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svdup_neonq_f32)))
136svfloat32_t svdup_neonq(float32x4_t);
137__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svdup_neonq_f64)))
138svfloat64_t svdup_neonq(float64x2_t);
139__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svdup_neonq_s8)))
140svint8_t svdup_neonq_s8(int8x16_t);
141__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svdup_neonq_s16)))
142svint16_t svdup_neonq_s16(int16x8_t);
143__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svdup_neonq_s32)))
144svint32_t svdup_neonq_s32(int32x4_t);
145__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svdup_neonq_s64)))
146svint64_t svdup_neonq_s64(int64x2_t);
147__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svdup_neonq_u8)))
148svuint8_t svdup_neonq_u8(uint8x16_t);
149__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svdup_neonq_u16)))
150svuint16_t svdup_neonq_u16(uint16x8_t);
151__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svdup_neonq_u32)))
152svuint32_t svdup_neonq_u32(uint32x4_t);
153__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svdup_neonq_u64)))
154svuint64_t svdup_neonq_u64(uint64x2_t);
155__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svdup_neonq_f16)))
156svfloat16_t svdup_neonq_f16(float16x8_t);
157__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svdup_neonq_f32)))
158svfloat32_t svdup_neonq_f32(float32x4_t);
159__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svdup_neonq_f64)))
160svfloat64_t svdup_neonq_f64(float64x2_t);
161
162__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svset_neonq_bf16)))
163svbfloat16_t svset_neonq(svbfloat16_t, bfloat16x8_t);
164__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svset_neonq_bf16)))
165svbfloat16_t svset_neonq_bf16(svbfloat16_t, bfloat16x8_t);
166__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svget_neonq_bf16)))
167bfloat16x8_t svget_neonq(svbfloat16_t);
168__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svget_neonq_bf16)))
169bfloat16x8_t svget_neonq_bf16(svbfloat16_t);
170__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svdup_neonq_bf16)))
171svbfloat16_t svdup_neonq(bfloat16x8_t);
172__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svdup_neonq_bf16)))
173svbfloat16_t svdup_neonq_bf16(bfloat16x8_t);
174
175#undef __ai
176#undef __aio
177
178#ifdef __cplusplus
179} // extern "C"
180#endif
181
182#endif //__ARM_NEON_SVE_BRIDGE_H
lib/include/arm_sve.h+7756-7908
......@@ -11,10 +11,6 @@
1111#ifndef __ARM_SVE_H
1212#define __ARM_SVE_H
1313
14#if !defined(__ARM_FEATURE_SVE)
15#error "SVE support not enabled"
16#else
17
1814#if !defined(__LITTLE_ENDIAN__)
1915#error "Big endian is currently not supported for arm_sve.h"
2016#endif
......@@ -39,19 +35,9 @@ typedef __SVUint32_t svuint32_t;
3935typedef __SVUint64_t svuint64_t;
4036typedef __SVFloat16_t svfloat16_t;
4137
42#if defined(__ARM_FEATURE_SVE_BF16) && !defined(__ARM_FEATURE_BF16_SCALAR_ARITHMETIC)
43#error "__ARM_FEATURE_BF16_SCALAR_ARITHMETIC must be defined when __ARM_FEATURE_SVE_BF16 is defined"
44#endif
45
46#if defined(__ARM_FEATURE_SVE_BF16)
4738typedef __SVBFloat16_t svbfloat16_t;
48#endif
49
50#if defined(__ARM_FEATURE_BF16_SCALAR_ARITHMETIC)
5139#include <arm_bf16.h>
5240typedef __bf16 bfloat16_t;
53#endif
54
5541typedef __SVFloat32_t svfloat32_t;
5642typedef __SVFloat64_t svfloat64_t;
5743typedef __clang_svint8x2_t svint8x2_t;
......@@ -89,11 +75,9 @@ typedef __clang_svfloat32x4_t svfloat32x4_t;
8975typedef __clang_svfloat64x4_t svfloat64x4_t;
9076typedef __SVBool_t svbool_t;
9177
92#ifdef __ARM_FEATURE_SVE_BF16
9378typedef __clang_svbfloat16x2_t svbfloat16x2_t;
9479typedef __clang_svbfloat16x3_t svbfloat16x3_t;
9580typedef __clang_svbfloat16x4_t svbfloat16x4_t;
96#endif
9781enum svpattern
9882{
9983 SV_POW2 = 0,
......@@ -145,9 +129,7 @@ enum svprfop
145129#define svreinterpret_s8_u32(...) __builtin_sve_reinterpret_s8_u32(__VA_ARGS__)
146130#define svreinterpret_s8_u64(...) __builtin_sve_reinterpret_s8_u64(__VA_ARGS__)
147131#define svreinterpret_s8_f16(...) __builtin_sve_reinterpret_s8_f16(__VA_ARGS__)
148#if defined(__ARM_FEATURE_SVE_BF16)
149132#define svreinterpret_s8_bf16(...) __builtin_sve_reinterpret_s8_bf16(__VA_ARGS__)
150#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
151133#define svreinterpret_s8_f32(...) __builtin_sve_reinterpret_s8_f32(__VA_ARGS__)
152134#define svreinterpret_s8_f64(...) __builtin_sve_reinterpret_s8_f64(__VA_ARGS__)
153135#define svreinterpret_s16_s8(...) __builtin_sve_reinterpret_s16_s8(__VA_ARGS__)
......@@ -159,9 +141,7 @@ enum svprfop
159141#define svreinterpret_s16_u32(...) __builtin_sve_reinterpret_s16_u32(__VA_ARGS__)
160142#define svreinterpret_s16_u64(...) __builtin_sve_reinterpret_s16_u64(__VA_ARGS__)
161143#define svreinterpret_s16_f16(...) __builtin_sve_reinterpret_s16_f16(__VA_ARGS__)
162#if defined(__ARM_FEATURE_SVE_BF16)
163144#define svreinterpret_s16_bf16(...) __builtin_sve_reinterpret_s16_bf16(__VA_ARGS__)
164#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
165145#define svreinterpret_s16_f32(...) __builtin_sve_reinterpret_s16_f32(__VA_ARGS__)
166146#define svreinterpret_s16_f64(...) __builtin_sve_reinterpret_s16_f64(__VA_ARGS__)
167147#define svreinterpret_s32_s8(...) __builtin_sve_reinterpret_s32_s8(__VA_ARGS__)
......@@ -173,9 +153,7 @@ enum svprfop
173153#define svreinterpret_s32_u32(...) __builtin_sve_reinterpret_s32_u32(__VA_ARGS__)
174154#define svreinterpret_s32_u64(...) __builtin_sve_reinterpret_s32_u64(__VA_ARGS__)
175155#define svreinterpret_s32_f16(...) __builtin_sve_reinterpret_s32_f16(__VA_ARGS__)
176#if defined(__ARM_FEATURE_SVE_BF16)
177156#define svreinterpret_s32_bf16(...) __builtin_sve_reinterpret_s32_bf16(__VA_ARGS__)
178#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
179157#define svreinterpret_s32_f32(...) __builtin_sve_reinterpret_s32_f32(__VA_ARGS__)
180158#define svreinterpret_s32_f64(...) __builtin_sve_reinterpret_s32_f64(__VA_ARGS__)
181159#define svreinterpret_s64_s8(...) __builtin_sve_reinterpret_s64_s8(__VA_ARGS__)
......@@ -187,9 +165,7 @@ enum svprfop
187165#define svreinterpret_s64_u32(...) __builtin_sve_reinterpret_s64_u32(__VA_ARGS__)
188166#define svreinterpret_s64_u64(...) __builtin_sve_reinterpret_s64_u64(__VA_ARGS__)
189167#define svreinterpret_s64_f16(...) __builtin_sve_reinterpret_s64_f16(__VA_ARGS__)
190#if defined(__ARM_FEATURE_SVE_BF16)
191168#define svreinterpret_s64_bf16(...) __builtin_sve_reinterpret_s64_bf16(__VA_ARGS__)
192#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
193169#define svreinterpret_s64_f32(...) __builtin_sve_reinterpret_s64_f32(__VA_ARGS__)
194170#define svreinterpret_s64_f64(...) __builtin_sve_reinterpret_s64_f64(__VA_ARGS__)
195171#define svreinterpret_u8_s8(...) __builtin_sve_reinterpret_u8_s8(__VA_ARGS__)
......@@ -201,9 +177,7 @@ enum svprfop
201177#define svreinterpret_u8_u32(...) __builtin_sve_reinterpret_u8_u32(__VA_ARGS__)
202178#define svreinterpret_u8_u64(...) __builtin_sve_reinterpret_u8_u64(__VA_ARGS__)
203179#define svreinterpret_u8_f16(...) __builtin_sve_reinterpret_u8_f16(__VA_ARGS__)
204#if defined(__ARM_FEATURE_SVE_BF16)
205180#define svreinterpret_u8_bf16(...) __builtin_sve_reinterpret_u8_bf16(__VA_ARGS__)
206#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
207181#define svreinterpret_u8_f32(...) __builtin_sve_reinterpret_u8_f32(__VA_ARGS__)
208182#define svreinterpret_u8_f64(...) __builtin_sve_reinterpret_u8_f64(__VA_ARGS__)
209183#define svreinterpret_u16_s8(...) __builtin_sve_reinterpret_u16_s8(__VA_ARGS__)
......@@ -215,9 +189,7 @@ enum svprfop
215189#define svreinterpret_u16_u32(...) __builtin_sve_reinterpret_u16_u32(__VA_ARGS__)
216190#define svreinterpret_u16_u64(...) __builtin_sve_reinterpret_u16_u64(__VA_ARGS__)
217191#define svreinterpret_u16_f16(...) __builtin_sve_reinterpret_u16_f16(__VA_ARGS__)
218#if defined(__ARM_FEATURE_SVE_BF16)
219192#define svreinterpret_u16_bf16(...) __builtin_sve_reinterpret_u16_bf16(__VA_ARGS__)
220#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
221193#define svreinterpret_u16_f32(...) __builtin_sve_reinterpret_u16_f32(__VA_ARGS__)
222194#define svreinterpret_u16_f64(...) __builtin_sve_reinterpret_u16_f64(__VA_ARGS__)
223195#define svreinterpret_u32_s8(...) __builtin_sve_reinterpret_u32_s8(__VA_ARGS__)
......@@ -229,9 +201,7 @@ enum svprfop
229201#define svreinterpret_u32_u32(...) __builtin_sve_reinterpret_u32_u32(__VA_ARGS__)
230202#define svreinterpret_u32_u64(...) __builtin_sve_reinterpret_u32_u64(__VA_ARGS__)
231203#define svreinterpret_u32_f16(...) __builtin_sve_reinterpret_u32_f16(__VA_ARGS__)
232#if defined(__ARM_FEATURE_SVE_BF16)
233204#define svreinterpret_u32_bf16(...) __builtin_sve_reinterpret_u32_bf16(__VA_ARGS__)
234#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
235205#define svreinterpret_u32_f32(...) __builtin_sve_reinterpret_u32_f32(__VA_ARGS__)
236206#define svreinterpret_u32_f64(...) __builtin_sve_reinterpret_u32_f64(__VA_ARGS__)
237207#define svreinterpret_u64_s8(...) __builtin_sve_reinterpret_u64_s8(__VA_ARGS__)
......@@ -243,9 +213,7 @@ enum svprfop
243213#define svreinterpret_u64_u32(...) __builtin_sve_reinterpret_u64_u32(__VA_ARGS__)
244214#define svreinterpret_u64_u64(...) __builtin_sve_reinterpret_u64_u64(__VA_ARGS__)
245215#define svreinterpret_u64_f16(...) __builtin_sve_reinterpret_u64_f16(__VA_ARGS__)
246#if defined(__ARM_FEATURE_SVE_BF16)
247216#define svreinterpret_u64_bf16(...) __builtin_sve_reinterpret_u64_bf16(__VA_ARGS__)
248#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
249217#define svreinterpret_u64_f32(...) __builtin_sve_reinterpret_u64_f32(__VA_ARGS__)
250218#define svreinterpret_u64_f64(...) __builtin_sve_reinterpret_u64_f64(__VA_ARGS__)
251219#define svreinterpret_f16_s8(...) __builtin_sve_reinterpret_f16_s8(__VA_ARGS__)
......@@ -257,47 +225,21 @@ enum svprfop
257225#define svreinterpret_f16_u32(...) __builtin_sve_reinterpret_f16_u32(__VA_ARGS__)
258226#define svreinterpret_f16_u64(...) __builtin_sve_reinterpret_f16_u64(__VA_ARGS__)
259227#define svreinterpret_f16_f16(...) __builtin_sve_reinterpret_f16_f16(__VA_ARGS__)
260#if defined(__ARM_FEATURE_SVE_BF16)
261228#define svreinterpret_f16_bf16(...) __builtin_sve_reinterpret_f16_bf16(__VA_ARGS__)
262#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
263229#define svreinterpret_f16_f32(...) __builtin_sve_reinterpret_f16_f32(__VA_ARGS__)
264230#define svreinterpret_f16_f64(...) __builtin_sve_reinterpret_f16_f64(__VA_ARGS__)
265#if defined(__ARM_FEATURE_SVE_BF16)
266231#define svreinterpret_bf16_s8(...) __builtin_sve_reinterpret_bf16_s8(__VA_ARGS__)
267#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
268#if defined(__ARM_FEATURE_SVE_BF16)
269232#define svreinterpret_bf16_s16(...) __builtin_sve_reinterpret_bf16_s16(__VA_ARGS__)
270#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
271#if defined(__ARM_FEATURE_SVE_BF16)
272233#define svreinterpret_bf16_s32(...) __builtin_sve_reinterpret_bf16_s32(__VA_ARGS__)
273#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
274#if defined(__ARM_FEATURE_SVE_BF16)
275234#define svreinterpret_bf16_s64(...) __builtin_sve_reinterpret_bf16_s64(__VA_ARGS__)
276#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
277#if defined(__ARM_FEATURE_SVE_BF16)
278235#define svreinterpret_bf16_u8(...) __builtin_sve_reinterpret_bf16_u8(__VA_ARGS__)
279#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
280#if defined(__ARM_FEATURE_SVE_BF16)
281236#define svreinterpret_bf16_u16(...) __builtin_sve_reinterpret_bf16_u16(__VA_ARGS__)
282#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
283#if defined(__ARM_FEATURE_SVE_BF16)
284237#define svreinterpret_bf16_u32(...) __builtin_sve_reinterpret_bf16_u32(__VA_ARGS__)
285#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
286#if defined(__ARM_FEATURE_SVE_BF16)
287238#define svreinterpret_bf16_u64(...) __builtin_sve_reinterpret_bf16_u64(__VA_ARGS__)
288#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
289#if defined(__ARM_FEATURE_SVE_BF16)
290239#define svreinterpret_bf16_f16(...) __builtin_sve_reinterpret_bf16_f16(__VA_ARGS__)
291#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
292#if defined(__ARM_FEATURE_SVE_BF16)
293240#define svreinterpret_bf16_bf16(...) __builtin_sve_reinterpret_bf16_bf16(__VA_ARGS__)
294#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
295#if defined(__ARM_FEATURE_SVE_BF16)
296241#define svreinterpret_bf16_f32(...) __builtin_sve_reinterpret_bf16_f32(__VA_ARGS__)
297#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
298#if defined(__ARM_FEATURE_SVE_BF16)
299242#define svreinterpret_bf16_f64(...) __builtin_sve_reinterpret_bf16_f64(__VA_ARGS__)
300#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
301243#define svreinterpret_f32_s8(...) __builtin_sve_reinterpret_f32_s8(__VA_ARGS__)
302244#define svreinterpret_f32_s16(...) __builtin_sve_reinterpret_f32_s16(__VA_ARGS__)
303245#define svreinterpret_f32_s32(...) __builtin_sve_reinterpret_f32_s32(__VA_ARGS__)
......@@ -307,9 +249,7 @@ enum svprfop
307249#define svreinterpret_f32_u32(...) __builtin_sve_reinterpret_f32_u32(__VA_ARGS__)
308250#define svreinterpret_f32_u64(...) __builtin_sve_reinterpret_f32_u64(__VA_ARGS__)
309251#define svreinterpret_f32_f16(...) __builtin_sve_reinterpret_f32_f16(__VA_ARGS__)
310#if defined(__ARM_FEATURE_SVE_BF16)
311252#define svreinterpret_f32_bf16(...) __builtin_sve_reinterpret_f32_bf16(__VA_ARGS__)
312#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
313253#define svreinterpret_f32_f32(...) __builtin_sve_reinterpret_f32_f32(__VA_ARGS__)
314254#define svreinterpret_f32_f64(...) __builtin_sve_reinterpret_f32_f64(__VA_ARGS__)
315255#define svreinterpret_f64_s8(...) __builtin_sve_reinterpret_f64_s8(__VA_ARGS__)
......@@ -321,630 +261,582 @@ enum svprfop
321261#define svreinterpret_f64_u32(...) __builtin_sve_reinterpret_f64_u32(__VA_ARGS__)
322262#define svreinterpret_f64_u64(...) __builtin_sve_reinterpret_f64_u64(__VA_ARGS__)
323263#define svreinterpret_f64_f16(...) __builtin_sve_reinterpret_f64_f16(__VA_ARGS__)
324#if defined(__ARM_FEATURE_SVE_BF16)
325264#define svreinterpret_f64_bf16(...) __builtin_sve_reinterpret_f64_bf16(__VA_ARGS__)
326#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
327265#define svreinterpret_f64_f32(...) __builtin_sve_reinterpret_f64_f32(__VA_ARGS__)
328266#define svreinterpret_f64_f64(...) __builtin_sve_reinterpret_f64_f64(__VA_ARGS__)
329__aio svint8_t svreinterpret_s8(svint8_t op) {
267__aio __attribute__((target("sve"))) svint8_t svreinterpret_s8(svint8_t op) {
330268 return __builtin_sve_reinterpret_s8_s8(op);
331269}
332270
333__aio svint8_t svreinterpret_s8(svint16_t op) {
271__aio __attribute__((target("sve"))) svint8_t svreinterpret_s8(svint16_t op) {
334272 return __builtin_sve_reinterpret_s8_s16(op);
335273}
336274
337__aio svint8_t svreinterpret_s8(svint32_t op) {
275__aio __attribute__((target("sve"))) svint8_t svreinterpret_s8(svint32_t op) {
338276 return __builtin_sve_reinterpret_s8_s32(op);
339277}
340278
341__aio svint8_t svreinterpret_s8(svint64_t op) {
279__aio __attribute__((target("sve"))) svint8_t svreinterpret_s8(svint64_t op) {
342280 return __builtin_sve_reinterpret_s8_s64(op);
343281}
344282
345__aio svint8_t svreinterpret_s8(svuint8_t op) {
283__aio __attribute__((target("sve"))) svint8_t svreinterpret_s8(svuint8_t op) {
346284 return __builtin_sve_reinterpret_s8_u8(op);
347285}
348286
349__aio svint8_t svreinterpret_s8(svuint16_t op) {
287__aio __attribute__((target("sve"))) svint8_t svreinterpret_s8(svuint16_t op) {
350288 return __builtin_sve_reinterpret_s8_u16(op);
351289}
352290
353__aio svint8_t svreinterpret_s8(svuint32_t op) {
291__aio __attribute__((target("sve"))) svint8_t svreinterpret_s8(svuint32_t op) {
354292 return __builtin_sve_reinterpret_s8_u32(op);
355293}
356294
357__aio svint8_t svreinterpret_s8(svuint64_t op) {
295__aio __attribute__((target("sve"))) svint8_t svreinterpret_s8(svuint64_t op) {
358296 return __builtin_sve_reinterpret_s8_u64(op);
359297}
360298
361__aio svint8_t svreinterpret_s8(svfloat16_t op) {
299__aio __attribute__((target("sve"))) svint8_t svreinterpret_s8(svfloat16_t op) {
362300 return __builtin_sve_reinterpret_s8_f16(op);
363301}
364302
365#if defined(__ARM_FEATURE_SVE_BF16)
366__aio svint8_t svreinterpret_s8(svbfloat16_t op) {
303__aio __attribute__((target("sve"))) svint8_t svreinterpret_s8(svbfloat16_t op) {
367304 return __builtin_sve_reinterpret_s8_bf16(op);
368305}
369306
370#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
371__aio svint8_t svreinterpret_s8(svfloat32_t op) {
307__aio __attribute__((target("sve"))) svint8_t svreinterpret_s8(svfloat32_t op) {
372308 return __builtin_sve_reinterpret_s8_f32(op);
373309}
374310
375__aio svint8_t svreinterpret_s8(svfloat64_t op) {
311__aio __attribute__((target("sve"))) svint8_t svreinterpret_s8(svfloat64_t op) {
376312 return __builtin_sve_reinterpret_s8_f64(op);
377313}
378314
379__aio svint16_t svreinterpret_s16(svint8_t op) {
315__aio __attribute__((target("sve"))) svint16_t svreinterpret_s16(svint8_t op) {
380316 return __builtin_sve_reinterpret_s16_s8(op);
381317}
382318
383__aio svint16_t svreinterpret_s16(svint16_t op) {
319__aio __attribute__((target("sve"))) svint16_t svreinterpret_s16(svint16_t op) {
384320 return __builtin_sve_reinterpret_s16_s16(op);
385321}
386322
387__aio svint16_t svreinterpret_s16(svint32_t op) {
323__aio __attribute__((target("sve"))) svint16_t svreinterpret_s16(svint32_t op) {
388324 return __builtin_sve_reinterpret_s16_s32(op);
389325}
390326
391__aio svint16_t svreinterpret_s16(svint64_t op) {
327__aio __attribute__((target("sve"))) svint16_t svreinterpret_s16(svint64_t op) {
392328 return __builtin_sve_reinterpret_s16_s64(op);
393329}
394330
395__aio svint16_t svreinterpret_s16(svuint8_t op) {
331__aio __attribute__((target("sve"))) svint16_t svreinterpret_s16(svuint8_t op) {
396332 return __builtin_sve_reinterpret_s16_u8(op);
397333}
398334
399__aio svint16_t svreinterpret_s16(svuint16_t op) {
335__aio __attribute__((target("sve"))) svint16_t svreinterpret_s16(svuint16_t op) {
400336 return __builtin_sve_reinterpret_s16_u16(op);
401337}
402338
403__aio svint16_t svreinterpret_s16(svuint32_t op) {
339__aio __attribute__((target("sve"))) svint16_t svreinterpret_s16(svuint32_t op) {
404340 return __builtin_sve_reinterpret_s16_u32(op);
405341}
406342
407__aio svint16_t svreinterpret_s16(svuint64_t op) {
343__aio __attribute__((target("sve"))) svint16_t svreinterpret_s16(svuint64_t op) {
408344 return __builtin_sve_reinterpret_s16_u64(op);
409345}
410346
411__aio svint16_t svreinterpret_s16(svfloat16_t op) {
347__aio __attribute__((target("sve"))) svint16_t svreinterpret_s16(svfloat16_t op) {
412348 return __builtin_sve_reinterpret_s16_f16(op);
413349}
414350
415#if defined(__ARM_FEATURE_SVE_BF16)
416__aio svint16_t svreinterpret_s16(svbfloat16_t op) {
351__aio __attribute__((target("sve"))) svint16_t svreinterpret_s16(svbfloat16_t op) {
417352 return __builtin_sve_reinterpret_s16_bf16(op);
418353}
419354
420#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
421__aio svint16_t svreinterpret_s16(svfloat32_t op) {
355__aio __attribute__((target("sve"))) svint16_t svreinterpret_s16(svfloat32_t op) {
422356 return __builtin_sve_reinterpret_s16_f32(op);
423357}
424358
425__aio svint16_t svreinterpret_s16(svfloat64_t op) {
359__aio __attribute__((target("sve"))) svint16_t svreinterpret_s16(svfloat64_t op) {
426360 return __builtin_sve_reinterpret_s16_f64(op);
427361}
428362
429__aio svint32_t svreinterpret_s32(svint8_t op) {
363__aio __attribute__((target("sve"))) svint32_t svreinterpret_s32(svint8_t op) {
430364 return __builtin_sve_reinterpret_s32_s8(op);
431365}
432366
433__aio svint32_t svreinterpret_s32(svint16_t op) {
367__aio __attribute__((target("sve"))) svint32_t svreinterpret_s32(svint16_t op) {
434368 return __builtin_sve_reinterpret_s32_s16(op);
435369}
436370
437__aio svint32_t svreinterpret_s32(svint32_t op) {
371__aio __attribute__((target("sve"))) svint32_t svreinterpret_s32(svint32_t op) {
438372 return __builtin_sve_reinterpret_s32_s32(op);
439373}
440374
441__aio svint32_t svreinterpret_s32(svint64_t op) {
375__aio __attribute__((target("sve"))) svint32_t svreinterpret_s32(svint64_t op) {
442376 return __builtin_sve_reinterpret_s32_s64(op);
443377}
444378
445__aio svint32_t svreinterpret_s32(svuint8_t op) {
379__aio __attribute__((target("sve"))) svint32_t svreinterpret_s32(svuint8_t op) {
446380 return __builtin_sve_reinterpret_s32_u8(op);
447381}
448382
449__aio svint32_t svreinterpret_s32(svuint16_t op) {
383__aio __attribute__((target("sve"))) svint32_t svreinterpret_s32(svuint16_t op) {
450384 return __builtin_sve_reinterpret_s32_u16(op);
451385}
452386
453__aio svint32_t svreinterpret_s32(svuint32_t op) {
387__aio __attribute__((target("sve"))) svint32_t svreinterpret_s32(svuint32_t op) {
454388 return __builtin_sve_reinterpret_s32_u32(op);
455389}
456390
457__aio svint32_t svreinterpret_s32(svuint64_t op) {
391__aio __attribute__((target("sve"))) svint32_t svreinterpret_s32(svuint64_t op) {
458392 return __builtin_sve_reinterpret_s32_u64(op);
459393}
460394
461__aio svint32_t svreinterpret_s32(svfloat16_t op) {
395__aio __attribute__((target("sve"))) svint32_t svreinterpret_s32(svfloat16_t op) {
462396 return __builtin_sve_reinterpret_s32_f16(op);
463397}
464398
465#if defined(__ARM_FEATURE_SVE_BF16)
466__aio svint32_t svreinterpret_s32(svbfloat16_t op) {
399__aio __attribute__((target("sve"))) svint32_t svreinterpret_s32(svbfloat16_t op) {
467400 return __builtin_sve_reinterpret_s32_bf16(op);
468401}
469402
470#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
471__aio svint32_t svreinterpret_s32(svfloat32_t op) {
403__aio __attribute__((target("sve"))) svint32_t svreinterpret_s32(svfloat32_t op) {
472404 return __builtin_sve_reinterpret_s32_f32(op);
473405}
474406
475__aio svint32_t svreinterpret_s32(svfloat64_t op) {
407__aio __attribute__((target("sve"))) svint32_t svreinterpret_s32(svfloat64_t op) {
476408 return __builtin_sve_reinterpret_s32_f64(op);
477409}
478410
479__aio svint64_t svreinterpret_s64(svint8_t op) {
411__aio __attribute__((target("sve"))) svint64_t svreinterpret_s64(svint8_t op) {
480412 return __builtin_sve_reinterpret_s64_s8(op);
481413}
482414
483__aio svint64_t svreinterpret_s64(svint16_t op) {
415__aio __attribute__((target("sve"))) svint64_t svreinterpret_s64(svint16_t op) {
484416 return __builtin_sve_reinterpret_s64_s16(op);
485417}
486418
487__aio svint64_t svreinterpret_s64(svint32_t op) {
419__aio __attribute__((target("sve"))) svint64_t svreinterpret_s64(svint32_t op) {
488420 return __builtin_sve_reinterpret_s64_s32(op);
489421}
490422
491__aio svint64_t svreinterpret_s64(svint64_t op) {
423__aio __attribute__((target("sve"))) svint64_t svreinterpret_s64(svint64_t op) {
492424 return __builtin_sve_reinterpret_s64_s64(op);
493425}
494426
495__aio svint64_t svreinterpret_s64(svuint8_t op) {
427__aio __attribute__((target("sve"))) svint64_t svreinterpret_s64(svuint8_t op) {
496428 return __builtin_sve_reinterpret_s64_u8(op);
497429}
498430
499__aio svint64_t svreinterpret_s64(svuint16_t op) {
431__aio __attribute__((target("sve"))) svint64_t svreinterpret_s64(svuint16_t op) {
500432 return __builtin_sve_reinterpret_s64_u16(op);
501433}
502434
503__aio svint64_t svreinterpret_s64(svuint32_t op) {
435__aio __attribute__((target("sve"))) svint64_t svreinterpret_s64(svuint32_t op) {
504436 return __builtin_sve_reinterpret_s64_u32(op);
505437}
506438
507__aio svint64_t svreinterpret_s64(svuint64_t op) {
439__aio __attribute__((target("sve"))) svint64_t svreinterpret_s64(svuint64_t op) {
508440 return __builtin_sve_reinterpret_s64_u64(op);
509441}
510442
511__aio svint64_t svreinterpret_s64(svfloat16_t op) {
443__aio __attribute__((target("sve"))) svint64_t svreinterpret_s64(svfloat16_t op) {
512444 return __builtin_sve_reinterpret_s64_f16(op);
513445}
514446
515#if defined(__ARM_FEATURE_SVE_BF16)
516__aio svint64_t svreinterpret_s64(svbfloat16_t op) {
447__aio __attribute__((target("sve"))) svint64_t svreinterpret_s64(svbfloat16_t op) {
517448 return __builtin_sve_reinterpret_s64_bf16(op);
518449}
519450
520#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
521__aio svint64_t svreinterpret_s64(svfloat32_t op) {
451__aio __attribute__((target("sve"))) svint64_t svreinterpret_s64(svfloat32_t op) {
522452 return __builtin_sve_reinterpret_s64_f32(op);
523453}
524454
525__aio svint64_t svreinterpret_s64(svfloat64_t op) {
455__aio __attribute__((target("sve"))) svint64_t svreinterpret_s64(svfloat64_t op) {
526456 return __builtin_sve_reinterpret_s64_f64(op);
527457}
528458
529__aio svuint8_t svreinterpret_u8(svint8_t op) {
459__aio __attribute__((target("sve"))) svuint8_t svreinterpret_u8(svint8_t op) {
530460 return __builtin_sve_reinterpret_u8_s8(op);
531461}
532462
533__aio svuint8_t svreinterpret_u8(svint16_t op) {
463__aio __attribute__((target("sve"))) svuint8_t svreinterpret_u8(svint16_t op) {
534464 return __builtin_sve_reinterpret_u8_s16(op);
535465}
536466
537__aio svuint8_t svreinterpret_u8(svint32_t op) {
467__aio __attribute__((target("sve"))) svuint8_t svreinterpret_u8(svint32_t op) {
538468 return __builtin_sve_reinterpret_u8_s32(op);
539469}
540470
541__aio svuint8_t svreinterpret_u8(svint64_t op) {
471__aio __attribute__((target("sve"))) svuint8_t svreinterpret_u8(svint64_t op) {
542472 return __builtin_sve_reinterpret_u8_s64(op);
543473}
544474
545__aio svuint8_t svreinterpret_u8(svuint8_t op) {
475__aio __attribute__((target("sve"))) svuint8_t svreinterpret_u8(svuint8_t op) {
546476 return __builtin_sve_reinterpret_u8_u8(op);
547477}
548478
549__aio svuint8_t svreinterpret_u8(svuint16_t op) {
479__aio __attribute__((target("sve"))) svuint8_t svreinterpret_u8(svuint16_t op) {
550480 return __builtin_sve_reinterpret_u8_u16(op);
551481}
552482
553__aio svuint8_t svreinterpret_u8(svuint32_t op) {
483__aio __attribute__((target("sve"))) svuint8_t svreinterpret_u8(svuint32_t op) {
554484 return __builtin_sve_reinterpret_u8_u32(op);
555485}
556486
557__aio svuint8_t svreinterpret_u8(svuint64_t op) {
487__aio __attribute__((target("sve"))) svuint8_t svreinterpret_u8(svuint64_t op) {
558488 return __builtin_sve_reinterpret_u8_u64(op);
559489}
560490
561__aio svuint8_t svreinterpret_u8(svfloat16_t op) {
491__aio __attribute__((target("sve"))) svuint8_t svreinterpret_u8(svfloat16_t op) {
562492 return __builtin_sve_reinterpret_u8_f16(op);
563493}
564494
565#if defined(__ARM_FEATURE_SVE_BF16)
566__aio svuint8_t svreinterpret_u8(svbfloat16_t op) {
495__aio __attribute__((target("sve"))) svuint8_t svreinterpret_u8(svbfloat16_t op) {
567496 return __builtin_sve_reinterpret_u8_bf16(op);
568497}
569498
570#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
571__aio svuint8_t svreinterpret_u8(svfloat32_t op) {
499__aio __attribute__((target("sve"))) svuint8_t svreinterpret_u8(svfloat32_t op) {
572500 return __builtin_sve_reinterpret_u8_f32(op);
573501}
574502
575__aio svuint8_t svreinterpret_u8(svfloat64_t op) {
503__aio __attribute__((target("sve"))) svuint8_t svreinterpret_u8(svfloat64_t op) {
576504 return __builtin_sve_reinterpret_u8_f64(op);
577505}
578506
579__aio svuint16_t svreinterpret_u16(svint8_t op) {
507__aio __attribute__((target("sve"))) svuint16_t svreinterpret_u16(svint8_t op) {
580508 return __builtin_sve_reinterpret_u16_s8(op);
581509}
582510
583__aio svuint16_t svreinterpret_u16(svint16_t op) {
511__aio __attribute__((target("sve"))) svuint16_t svreinterpret_u16(svint16_t op) {
584512 return __builtin_sve_reinterpret_u16_s16(op);
585513}
586514
587__aio svuint16_t svreinterpret_u16(svint32_t op) {
515__aio __attribute__((target("sve"))) svuint16_t svreinterpret_u16(svint32_t op) {
588516 return __builtin_sve_reinterpret_u16_s32(op);
589517}
590518
591__aio svuint16_t svreinterpret_u16(svint64_t op) {
519__aio __attribute__((target("sve"))) svuint16_t svreinterpret_u16(svint64_t op) {
592520 return __builtin_sve_reinterpret_u16_s64(op);
593521}
594522
595__aio svuint16_t svreinterpret_u16(svuint8_t op) {
523__aio __attribute__((target("sve"))) svuint16_t svreinterpret_u16(svuint8_t op) {
596524 return __builtin_sve_reinterpret_u16_u8(op);
597525}
598526
599__aio svuint16_t svreinterpret_u16(svuint16_t op) {
527__aio __attribute__((target("sve"))) svuint16_t svreinterpret_u16(svuint16_t op) {
600528 return __builtin_sve_reinterpret_u16_u16(op);
601529}
602530
603__aio svuint16_t svreinterpret_u16(svuint32_t op) {
531__aio __attribute__((target("sve"))) svuint16_t svreinterpret_u16(svuint32_t op) {
604532 return __builtin_sve_reinterpret_u16_u32(op);
605533}
606534
607__aio svuint16_t svreinterpret_u16(svuint64_t op) {
535__aio __attribute__((target("sve"))) svuint16_t svreinterpret_u16(svuint64_t op) {
608536 return __builtin_sve_reinterpret_u16_u64(op);
609537}
610538
611__aio svuint16_t svreinterpret_u16(svfloat16_t op) {
539__aio __attribute__((target("sve"))) svuint16_t svreinterpret_u16(svfloat16_t op) {
612540 return __builtin_sve_reinterpret_u16_f16(op);
613541}
614542
615#if defined(__ARM_FEATURE_SVE_BF16)
616__aio svuint16_t svreinterpret_u16(svbfloat16_t op) {
543__aio __attribute__((target("sve"))) svuint16_t svreinterpret_u16(svbfloat16_t op) {
617544 return __builtin_sve_reinterpret_u16_bf16(op);
618545}
619546
620#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
621__aio svuint16_t svreinterpret_u16(svfloat32_t op) {
547__aio __attribute__((target("sve"))) svuint16_t svreinterpret_u16(svfloat32_t op) {
622548 return __builtin_sve_reinterpret_u16_f32(op);
623549}
624550
625__aio svuint16_t svreinterpret_u16(svfloat64_t op) {
551__aio __attribute__((target("sve"))) svuint16_t svreinterpret_u16(svfloat64_t op) {
626552 return __builtin_sve_reinterpret_u16_f64(op);
627553}
628554
629__aio svuint32_t svreinterpret_u32(svint8_t op) {
555__aio __attribute__((target("sve"))) svuint32_t svreinterpret_u32(svint8_t op) {
630556 return __builtin_sve_reinterpret_u32_s8(op);
631557}
632558
633__aio svuint32_t svreinterpret_u32(svint16_t op) {
559__aio __attribute__((target("sve"))) svuint32_t svreinterpret_u32(svint16_t op) {
634560 return __builtin_sve_reinterpret_u32_s16(op);
635561}
636562
637__aio svuint32_t svreinterpret_u32(svint32_t op) {
563__aio __attribute__((target("sve"))) svuint32_t svreinterpret_u32(svint32_t op) {
638564 return __builtin_sve_reinterpret_u32_s32(op);
639565}
640566
641__aio svuint32_t svreinterpret_u32(svint64_t op) {
567__aio __attribute__((target("sve"))) svuint32_t svreinterpret_u32(svint64_t op) {
642568 return __builtin_sve_reinterpret_u32_s64(op);
643569}
644570
645__aio svuint32_t svreinterpret_u32(svuint8_t op) {
571__aio __attribute__((target("sve"))) svuint32_t svreinterpret_u32(svuint8_t op) {
646572 return __builtin_sve_reinterpret_u32_u8(op);
647573}
648574
649__aio svuint32_t svreinterpret_u32(svuint16_t op) {
575__aio __attribute__((target("sve"))) svuint32_t svreinterpret_u32(svuint16_t op) {
650576 return __builtin_sve_reinterpret_u32_u16(op);
651577}
652578
653__aio svuint32_t svreinterpret_u32(svuint32_t op) {
579__aio __attribute__((target("sve"))) svuint32_t svreinterpret_u32(svuint32_t op) {
654580 return __builtin_sve_reinterpret_u32_u32(op);
655581}
656582
657__aio svuint32_t svreinterpret_u32(svuint64_t op) {
583__aio __attribute__((target("sve"))) svuint32_t svreinterpret_u32(svuint64_t op) {
658584 return __builtin_sve_reinterpret_u32_u64(op);
659585}
660586
661__aio svuint32_t svreinterpret_u32(svfloat16_t op) {
587__aio __attribute__((target("sve"))) svuint32_t svreinterpret_u32(svfloat16_t op) {
662588 return __builtin_sve_reinterpret_u32_f16(op);
663589}
664590
665#if defined(__ARM_FEATURE_SVE_BF16)
666__aio svuint32_t svreinterpret_u32(svbfloat16_t op) {
591__aio __attribute__((target("sve"))) svuint32_t svreinterpret_u32(svbfloat16_t op) {
667592 return __builtin_sve_reinterpret_u32_bf16(op);
668593}
669594
670#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
671__aio svuint32_t svreinterpret_u32(svfloat32_t op) {
595__aio __attribute__((target("sve"))) svuint32_t svreinterpret_u32(svfloat32_t op) {
672596 return __builtin_sve_reinterpret_u32_f32(op);
673597}
674598
675__aio svuint32_t svreinterpret_u32(svfloat64_t op) {
599__aio __attribute__((target("sve"))) svuint32_t svreinterpret_u32(svfloat64_t op) {
676600 return __builtin_sve_reinterpret_u32_f64(op);
677601}
678602
679__aio svuint64_t svreinterpret_u64(svint8_t op) {
603__aio __attribute__((target("sve"))) svuint64_t svreinterpret_u64(svint8_t op) {
680604 return __builtin_sve_reinterpret_u64_s8(op);
681605}
682606
683__aio svuint64_t svreinterpret_u64(svint16_t op) {
607__aio __attribute__((target("sve"))) svuint64_t svreinterpret_u64(svint16_t op) {
684608 return __builtin_sve_reinterpret_u64_s16(op);
685609}
686610
687__aio svuint64_t svreinterpret_u64(svint32_t op) {
611__aio __attribute__((target("sve"))) svuint64_t svreinterpret_u64(svint32_t op) {
688612 return __builtin_sve_reinterpret_u64_s32(op);
689613}
690614
691__aio svuint64_t svreinterpret_u64(svint64_t op) {
615__aio __attribute__((target("sve"))) svuint64_t svreinterpret_u64(svint64_t op) {
692616 return __builtin_sve_reinterpret_u64_s64(op);
693617}
694618
695__aio svuint64_t svreinterpret_u64(svuint8_t op) {
619__aio __attribute__((target("sve"))) svuint64_t svreinterpret_u64(svuint8_t op) {
696620 return __builtin_sve_reinterpret_u64_u8(op);
697621}
698622
699__aio svuint64_t svreinterpret_u64(svuint16_t op) {
623__aio __attribute__((target("sve"))) svuint64_t svreinterpret_u64(svuint16_t op) {
700624 return __builtin_sve_reinterpret_u64_u16(op);
701625}
702626
703__aio svuint64_t svreinterpret_u64(svuint32_t op) {
627__aio __attribute__((target("sve"))) svuint64_t svreinterpret_u64(svuint32_t op) {
704628 return __builtin_sve_reinterpret_u64_u32(op);
705629}
706630
707__aio svuint64_t svreinterpret_u64(svuint64_t op) {
631__aio __attribute__((target("sve"))) svuint64_t svreinterpret_u64(svuint64_t op) {
708632 return __builtin_sve_reinterpret_u64_u64(op);
709633}
710634
711__aio svuint64_t svreinterpret_u64(svfloat16_t op) {
635__aio __attribute__((target("sve"))) svuint64_t svreinterpret_u64(svfloat16_t op) {
712636 return __builtin_sve_reinterpret_u64_f16(op);
713637}
714638
715#if defined(__ARM_FEATURE_SVE_BF16)
716__aio svuint64_t svreinterpret_u64(svbfloat16_t op) {
639__aio __attribute__((target("sve"))) svuint64_t svreinterpret_u64(svbfloat16_t op) {
717640 return __builtin_sve_reinterpret_u64_bf16(op);
718641}
719642
720#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
721__aio svuint64_t svreinterpret_u64(svfloat32_t op) {
643__aio __attribute__((target("sve"))) svuint64_t svreinterpret_u64(svfloat32_t op) {
722644 return __builtin_sve_reinterpret_u64_f32(op);
723645}
724646
725__aio svuint64_t svreinterpret_u64(svfloat64_t op) {
647__aio __attribute__((target("sve"))) svuint64_t svreinterpret_u64(svfloat64_t op) {
726648 return __builtin_sve_reinterpret_u64_f64(op);
727649}
728650
729__aio svfloat16_t svreinterpret_f16(svint8_t op) {
651__aio __attribute__((target("sve"))) svfloat16_t svreinterpret_f16(svint8_t op) {
730652 return __builtin_sve_reinterpret_f16_s8(op);
731653}
732654
733__aio svfloat16_t svreinterpret_f16(svint16_t op) {
655__aio __attribute__((target("sve"))) svfloat16_t svreinterpret_f16(svint16_t op) {
734656 return __builtin_sve_reinterpret_f16_s16(op);
735657}
736658
737__aio svfloat16_t svreinterpret_f16(svint32_t op) {
659__aio __attribute__((target("sve"))) svfloat16_t svreinterpret_f16(svint32_t op) {
738660 return __builtin_sve_reinterpret_f16_s32(op);
739661}
740662
741__aio svfloat16_t svreinterpret_f16(svint64_t op) {
663__aio __attribute__((target("sve"))) svfloat16_t svreinterpret_f16(svint64_t op) {
742664 return __builtin_sve_reinterpret_f16_s64(op);
743665}
744666
745__aio svfloat16_t svreinterpret_f16(svuint8_t op) {
667__aio __attribute__((target("sve"))) svfloat16_t svreinterpret_f16(svuint8_t op) {
746668 return __builtin_sve_reinterpret_f16_u8(op);
747669}
748670
749__aio svfloat16_t svreinterpret_f16(svuint16_t op) {
671__aio __attribute__((target("sve"))) svfloat16_t svreinterpret_f16(svuint16_t op) {
750672 return __builtin_sve_reinterpret_f16_u16(op);
751673}
752674
753__aio svfloat16_t svreinterpret_f16(svuint32_t op) {
675__aio __attribute__((target("sve"))) svfloat16_t svreinterpret_f16(svuint32_t op) {
754676 return __builtin_sve_reinterpret_f16_u32(op);
755677}
756678
757__aio svfloat16_t svreinterpret_f16(svuint64_t op) {
679__aio __attribute__((target("sve"))) svfloat16_t svreinterpret_f16(svuint64_t op) {
758680 return __builtin_sve_reinterpret_f16_u64(op);
759681}
760682
761__aio svfloat16_t svreinterpret_f16(svfloat16_t op) {
683__aio __attribute__((target("sve"))) svfloat16_t svreinterpret_f16(svfloat16_t op) {
762684 return __builtin_sve_reinterpret_f16_f16(op);
763685}
764686
765#if defined(__ARM_FEATURE_SVE_BF16)
766__aio svfloat16_t svreinterpret_f16(svbfloat16_t op) {
687__aio __attribute__((target("sve"))) svfloat16_t svreinterpret_f16(svbfloat16_t op) {
767688 return __builtin_sve_reinterpret_f16_bf16(op);
768689}
769690
770#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
771__aio svfloat16_t svreinterpret_f16(svfloat32_t op) {
691__aio __attribute__((target("sve"))) svfloat16_t svreinterpret_f16(svfloat32_t op) {
772692 return __builtin_sve_reinterpret_f16_f32(op);
773693}
774694
775__aio svfloat16_t svreinterpret_f16(svfloat64_t op) {
695__aio __attribute__((target("sve"))) svfloat16_t svreinterpret_f16(svfloat64_t op) {
776696 return __builtin_sve_reinterpret_f16_f64(op);
777697}
778698
779#if defined(__ARM_FEATURE_SVE_BF16)
780__aio svbfloat16_t svreinterpret_bf16(svint8_t op) {
699__aio __attribute__((target("sve"))) svbfloat16_t svreinterpret_bf16(svint8_t op) {
781700 return __builtin_sve_reinterpret_bf16_s8(op);
782701}
783702
784#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
785#if defined(__ARM_FEATURE_SVE_BF16)
786__aio svbfloat16_t svreinterpret_bf16(svint16_t op) {
703__aio __attribute__((target("sve"))) svbfloat16_t svreinterpret_bf16(svint16_t op) {
787704 return __builtin_sve_reinterpret_bf16_s16(op);
788705}
789706
790#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
791#if defined(__ARM_FEATURE_SVE_BF16)
792__aio svbfloat16_t svreinterpret_bf16(svint32_t op) {
707__aio __attribute__((target("sve"))) svbfloat16_t svreinterpret_bf16(svint32_t op) {
793708 return __builtin_sve_reinterpret_bf16_s32(op);
794709}
795710
796#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
797#if defined(__ARM_FEATURE_SVE_BF16)
798__aio svbfloat16_t svreinterpret_bf16(svint64_t op) {
711__aio __attribute__((target("sve"))) svbfloat16_t svreinterpret_bf16(svint64_t op) {
799712 return __builtin_sve_reinterpret_bf16_s64(op);
800713}
801714
802#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
803#if defined(__ARM_FEATURE_SVE_BF16)
804__aio svbfloat16_t svreinterpret_bf16(svuint8_t op) {
715__aio __attribute__((target("sve"))) svbfloat16_t svreinterpret_bf16(svuint8_t op) {
805716 return __builtin_sve_reinterpret_bf16_u8(op);
806717}
807718
808#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
809#if defined(__ARM_FEATURE_SVE_BF16)
810__aio svbfloat16_t svreinterpret_bf16(svuint16_t op) {
719__aio __attribute__((target("sve"))) svbfloat16_t svreinterpret_bf16(svuint16_t op) {
811720 return __builtin_sve_reinterpret_bf16_u16(op);
812721}
813722
814#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
815#if defined(__ARM_FEATURE_SVE_BF16)
816__aio svbfloat16_t svreinterpret_bf16(svuint32_t op) {
723__aio __attribute__((target("sve"))) svbfloat16_t svreinterpret_bf16(svuint32_t op) {
817724 return __builtin_sve_reinterpret_bf16_u32(op);
818725}
819726
820#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
821#if defined(__ARM_FEATURE_SVE_BF16)
822__aio svbfloat16_t svreinterpret_bf16(svuint64_t op) {
727__aio __attribute__((target("sve"))) svbfloat16_t svreinterpret_bf16(svuint64_t op) {
823728 return __builtin_sve_reinterpret_bf16_u64(op);
824729}
825730
826#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
827#if defined(__ARM_FEATURE_SVE_BF16)
828__aio svbfloat16_t svreinterpret_bf16(svfloat16_t op) {
731__aio __attribute__((target("sve"))) svbfloat16_t svreinterpret_bf16(svfloat16_t op) {
829732 return __builtin_sve_reinterpret_bf16_f16(op);
830733}
831734
832#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
833#if defined(__ARM_FEATURE_SVE_BF16)
834__aio svbfloat16_t svreinterpret_bf16(svbfloat16_t op) {
735__aio __attribute__((target("sve"))) svbfloat16_t svreinterpret_bf16(svbfloat16_t op) {
835736 return __builtin_sve_reinterpret_bf16_bf16(op);
836737}
837738
838#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
839#if defined(__ARM_FEATURE_SVE_BF16)
840__aio svbfloat16_t svreinterpret_bf16(svfloat32_t op) {
739__aio __attribute__((target("sve"))) svbfloat16_t svreinterpret_bf16(svfloat32_t op) {
841740 return __builtin_sve_reinterpret_bf16_f32(op);
842741}
843742
844#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
845#if defined(__ARM_FEATURE_SVE_BF16)
846__aio svbfloat16_t svreinterpret_bf16(svfloat64_t op) {
743__aio __attribute__((target("sve"))) svbfloat16_t svreinterpret_bf16(svfloat64_t op) {
847744 return __builtin_sve_reinterpret_bf16_f64(op);
848745}
849746
850#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
851__aio svfloat32_t svreinterpret_f32(svint8_t op) {
747__aio __attribute__((target("sve"))) svfloat32_t svreinterpret_f32(svint8_t op) {
852748 return __builtin_sve_reinterpret_f32_s8(op);
853749}
854750
855__aio svfloat32_t svreinterpret_f32(svint16_t op) {
751__aio __attribute__((target("sve"))) svfloat32_t svreinterpret_f32(svint16_t op) {
856752 return __builtin_sve_reinterpret_f32_s16(op);
857753}
858754
859__aio svfloat32_t svreinterpret_f32(svint32_t op) {
755__aio __attribute__((target("sve"))) svfloat32_t svreinterpret_f32(svint32_t op) {
860756 return __builtin_sve_reinterpret_f32_s32(op);
861757}
862758
863__aio svfloat32_t svreinterpret_f32(svint64_t op) {
759__aio __attribute__((target("sve"))) svfloat32_t svreinterpret_f32(svint64_t op) {
864760 return __builtin_sve_reinterpret_f32_s64(op);
865761}
866762
867__aio svfloat32_t svreinterpret_f32(svuint8_t op) {
763__aio __attribute__((target("sve"))) svfloat32_t svreinterpret_f32(svuint8_t op) {
868764 return __builtin_sve_reinterpret_f32_u8(op);
869765}
870766
871__aio svfloat32_t svreinterpret_f32(svuint16_t op) {
767__aio __attribute__((target("sve"))) svfloat32_t svreinterpret_f32(svuint16_t op) {
872768 return __builtin_sve_reinterpret_f32_u16(op);
873769}
874770
875__aio svfloat32_t svreinterpret_f32(svuint32_t op) {
771__aio __attribute__((target("sve"))) svfloat32_t svreinterpret_f32(svuint32_t op) {
876772 return __builtin_sve_reinterpret_f32_u32(op);
877773}
878774
879__aio svfloat32_t svreinterpret_f32(svuint64_t op) {
775__aio __attribute__((target("sve"))) svfloat32_t svreinterpret_f32(svuint64_t op) {
880776 return __builtin_sve_reinterpret_f32_u64(op);
881777}
882778
883__aio svfloat32_t svreinterpret_f32(svfloat16_t op) {
779__aio __attribute__((target("sve"))) svfloat32_t svreinterpret_f32(svfloat16_t op) {
884780 return __builtin_sve_reinterpret_f32_f16(op);
885781}
886782
887#if defined(__ARM_FEATURE_SVE_BF16)
888__aio svfloat32_t svreinterpret_f32(svbfloat16_t op) {
783__aio __attribute__((target("sve"))) svfloat32_t svreinterpret_f32(svbfloat16_t op) {
889784 return __builtin_sve_reinterpret_f32_bf16(op);
890785}
891786
892#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
893__aio svfloat32_t svreinterpret_f32(svfloat32_t op) {
787__aio __attribute__((target("sve"))) svfloat32_t svreinterpret_f32(svfloat32_t op) {
894788 return __builtin_sve_reinterpret_f32_f32(op);
895789}
896790
897__aio svfloat32_t svreinterpret_f32(svfloat64_t op) {
791__aio __attribute__((target("sve"))) svfloat32_t svreinterpret_f32(svfloat64_t op) {
898792 return __builtin_sve_reinterpret_f32_f64(op);
899793}
900794
901__aio svfloat64_t svreinterpret_f64(svint8_t op) {
795__aio __attribute__((target("sve"))) svfloat64_t svreinterpret_f64(svint8_t op) {
902796 return __builtin_sve_reinterpret_f64_s8(op);
903797}
904798
905__aio svfloat64_t svreinterpret_f64(svint16_t op) {
799__aio __attribute__((target("sve"))) svfloat64_t svreinterpret_f64(svint16_t op) {
906800 return __builtin_sve_reinterpret_f64_s16(op);
907801}
908802
909__aio svfloat64_t svreinterpret_f64(svint32_t op) {
803__aio __attribute__((target("sve"))) svfloat64_t svreinterpret_f64(svint32_t op) {
910804 return __builtin_sve_reinterpret_f64_s32(op);
911805}
912806
913__aio svfloat64_t svreinterpret_f64(svint64_t op) {
807__aio __attribute__((target("sve"))) svfloat64_t svreinterpret_f64(svint64_t op) {
914808 return __builtin_sve_reinterpret_f64_s64(op);
915809}
916810
917__aio svfloat64_t svreinterpret_f64(svuint8_t op) {
811__aio __attribute__((target("sve"))) svfloat64_t svreinterpret_f64(svuint8_t op) {
918812 return __builtin_sve_reinterpret_f64_u8(op);
919813}
920814
921__aio svfloat64_t svreinterpret_f64(svuint16_t op) {
815__aio __attribute__((target("sve"))) svfloat64_t svreinterpret_f64(svuint16_t op) {
922816 return __builtin_sve_reinterpret_f64_u16(op);
923817}
924818
925__aio svfloat64_t svreinterpret_f64(svuint32_t op) {
819__aio __attribute__((target("sve"))) svfloat64_t svreinterpret_f64(svuint32_t op) {
926820 return __builtin_sve_reinterpret_f64_u32(op);
927821}
928822
929__aio svfloat64_t svreinterpret_f64(svuint64_t op) {
823__aio __attribute__((target("sve"))) svfloat64_t svreinterpret_f64(svuint64_t op) {
930824 return __builtin_sve_reinterpret_f64_u64(op);
931825}
932826
933__aio svfloat64_t svreinterpret_f64(svfloat16_t op) {
827__aio __attribute__((target("sve"))) svfloat64_t svreinterpret_f64(svfloat16_t op) {
934828 return __builtin_sve_reinterpret_f64_f16(op);
935829}
936830
937#if defined(__ARM_FEATURE_SVE_BF16)
938__aio svfloat64_t svreinterpret_f64(svbfloat16_t op) {
831__aio __attribute__((target("sve"))) svfloat64_t svreinterpret_f64(svbfloat16_t op) {
939832 return __builtin_sve_reinterpret_f64_bf16(op);
940833}
941834
942#endif /* #if defined(__ARM_FEATURE_SVE_BF16) */
943__aio svfloat64_t svreinterpret_f64(svfloat32_t op) {
835__aio __attribute__((target("sve"))) svfloat64_t svreinterpret_f64(svfloat32_t op) {
944836 return __builtin_sve_reinterpret_f64_f32(op);
945837}
946838
947__aio svfloat64_t svreinterpret_f64(svfloat64_t op) {
839__aio __attribute__((target("sve"))) svfloat64_t svreinterpret_f64(svfloat64_t op) {
948840 return __builtin_sve_reinterpret_f64_f64(op);
949841}
950842
......@@ -15698,7617 +15590,6 @@ __aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svzip2_s64)))
1569815590svint64_t svzip2(svint64_t, svint64_t);
1569915591__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svzip2_s16)))
1570015592svint16_t svzip2(svint16_t, svint16_t);
15701
15702#if defined (__ARM_FEATURE_SVE2_BITPERM)
15703__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_n_u8)))
15704svuint8_t svbdep_n_u8(svuint8_t, uint8_t);
15705__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_n_u32)))
15706svuint32_t svbdep_n_u32(svuint32_t, uint32_t);
15707__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_n_u64)))
15708svuint64_t svbdep_n_u64(svuint64_t, uint64_t);
15709__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_n_u16)))
15710svuint16_t svbdep_n_u16(svuint16_t, uint16_t);
15711__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_u8)))
15712svuint8_t svbdep_u8(svuint8_t, svuint8_t);
15713__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_u32)))
15714svuint32_t svbdep_u32(svuint32_t, svuint32_t);
15715__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_u64)))
15716svuint64_t svbdep_u64(svuint64_t, svuint64_t);
15717__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_u16)))
15718svuint16_t svbdep_u16(svuint16_t, svuint16_t);
15719__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_n_u8)))
15720svuint8_t svbext_n_u8(svuint8_t, uint8_t);
15721__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_n_u32)))
15722svuint32_t svbext_n_u32(svuint32_t, uint32_t);
15723__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_n_u64)))
15724svuint64_t svbext_n_u64(svuint64_t, uint64_t);
15725__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_n_u16)))
15726svuint16_t svbext_n_u16(svuint16_t, uint16_t);
15727__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_u8)))
15728svuint8_t svbext_u8(svuint8_t, svuint8_t);
15729__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_u32)))
15730svuint32_t svbext_u32(svuint32_t, svuint32_t);
15731__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_u64)))
15732svuint64_t svbext_u64(svuint64_t, svuint64_t);
15733__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_u16)))
15734svuint16_t svbext_u16(svuint16_t, svuint16_t);
15735__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_n_u8)))
15736svuint8_t svbgrp_n_u8(svuint8_t, uint8_t);
15737__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_n_u32)))
15738svuint32_t svbgrp_n_u32(svuint32_t, uint32_t);
15739__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_n_u64)))
15740svuint64_t svbgrp_n_u64(svuint64_t, uint64_t);
15741__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_n_u16)))
15742svuint16_t svbgrp_n_u16(svuint16_t, uint16_t);
15743__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_u8)))
15744svuint8_t svbgrp_u8(svuint8_t, svuint8_t);
15745__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_u32)))
15746svuint32_t svbgrp_u32(svuint32_t, svuint32_t);
15747__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_u64)))
15748svuint64_t svbgrp_u64(svuint64_t, svuint64_t);
15749__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_u16)))
15750svuint16_t svbgrp_u16(svuint16_t, svuint16_t);
15751__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_n_u8)))
15752svuint8_t svbdep(svuint8_t, uint8_t);
15753__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_n_u32)))
15754svuint32_t svbdep(svuint32_t, uint32_t);
15755__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_n_u64)))
15756svuint64_t svbdep(svuint64_t, uint64_t);
15757__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_n_u16)))
15758svuint16_t svbdep(svuint16_t, uint16_t);
15759__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_u8)))
15760svuint8_t svbdep(svuint8_t, svuint8_t);
15761__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_u32)))
15762svuint32_t svbdep(svuint32_t, svuint32_t);
15763__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_u64)))
15764svuint64_t svbdep(svuint64_t, svuint64_t);
15765__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_u16)))
15766svuint16_t svbdep(svuint16_t, svuint16_t);
15767__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_n_u8)))
15768svuint8_t svbext(svuint8_t, uint8_t);
15769__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_n_u32)))
15770svuint32_t svbext(svuint32_t, uint32_t);
15771__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_n_u64)))
15772svuint64_t svbext(svuint64_t, uint64_t);
15773__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_n_u16)))
15774svuint16_t svbext(svuint16_t, uint16_t);
15775__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_u8)))
15776svuint8_t svbext(svuint8_t, svuint8_t);
15777__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_u32)))
15778svuint32_t svbext(svuint32_t, svuint32_t);
15779__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_u64)))
15780svuint64_t svbext(svuint64_t, svuint64_t);
15781__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_u16)))
15782svuint16_t svbext(svuint16_t, svuint16_t);
15783__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_n_u8)))
15784svuint8_t svbgrp(svuint8_t, uint8_t);
15785__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_n_u32)))
15786svuint32_t svbgrp(svuint32_t, uint32_t);
15787__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_n_u64)))
15788svuint64_t svbgrp(svuint64_t, uint64_t);
15789__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_n_u16)))
15790svuint16_t svbgrp(svuint16_t, uint16_t);
15791__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_u8)))
15792svuint8_t svbgrp(svuint8_t, svuint8_t);
15793__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_u32)))
15794svuint32_t svbgrp(svuint32_t, svuint32_t);
15795__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_u64)))
15796svuint64_t svbgrp(svuint64_t, svuint64_t);
15797__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_u16)))
15798svuint16_t svbgrp(svuint16_t, svuint16_t);
15799#endif //defined (__ARM_FEATURE_SVE2_BITPERM)
15800
15801#if defined(__ARM_FEATURE_SVE2)
15802__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_s8)))
15803svint8_t svaba_n_s8(svint8_t, svint8_t, int8_t);
15804__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_s32)))
15805svint32_t svaba_n_s32(svint32_t, svint32_t, int32_t);
15806__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_s64)))
15807svint64_t svaba_n_s64(svint64_t, svint64_t, int64_t);
15808__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_s16)))
15809svint16_t svaba_n_s16(svint16_t, svint16_t, int16_t);
15810__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_u8)))
15811svuint8_t svaba_n_u8(svuint8_t, svuint8_t, uint8_t);
15812__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_u32)))
15813svuint32_t svaba_n_u32(svuint32_t, svuint32_t, uint32_t);
15814__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_u64)))
15815svuint64_t svaba_n_u64(svuint64_t, svuint64_t, uint64_t);
15816__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_u16)))
15817svuint16_t svaba_n_u16(svuint16_t, svuint16_t, uint16_t);
15818__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_s8)))
15819svint8_t svaba_s8(svint8_t, svint8_t, svint8_t);
15820__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_s32)))
15821svint32_t svaba_s32(svint32_t, svint32_t, svint32_t);
15822__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_s64)))
15823svint64_t svaba_s64(svint64_t, svint64_t, svint64_t);
15824__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_s16)))
15825svint16_t svaba_s16(svint16_t, svint16_t, svint16_t);
15826__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_u8)))
15827svuint8_t svaba_u8(svuint8_t, svuint8_t, svuint8_t);
15828__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_u32)))
15829svuint32_t svaba_u32(svuint32_t, svuint32_t, svuint32_t);
15830__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_u64)))
15831svuint64_t svaba_u64(svuint64_t, svuint64_t, svuint64_t);
15832__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_u16)))
15833svuint16_t svaba_u16(svuint16_t, svuint16_t, svuint16_t);
15834__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_n_s32)))
15835svint32_t svabalb_n_s32(svint32_t, svint16_t, int16_t);
15836__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_n_s64)))
15837svint64_t svabalb_n_s64(svint64_t, svint32_t, int32_t);
15838__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_n_s16)))
15839svint16_t svabalb_n_s16(svint16_t, svint8_t, int8_t);
15840__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_n_u32)))
15841svuint32_t svabalb_n_u32(svuint32_t, svuint16_t, uint16_t);
15842__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_n_u64)))
15843svuint64_t svabalb_n_u64(svuint64_t, svuint32_t, uint32_t);
15844__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_n_u16)))
15845svuint16_t svabalb_n_u16(svuint16_t, svuint8_t, uint8_t);
15846__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_s32)))
15847svint32_t svabalb_s32(svint32_t, svint16_t, svint16_t);
15848__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_s64)))
15849svint64_t svabalb_s64(svint64_t, svint32_t, svint32_t);
15850__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_s16)))
15851svint16_t svabalb_s16(svint16_t, svint8_t, svint8_t);
15852__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_u32)))
15853svuint32_t svabalb_u32(svuint32_t, svuint16_t, svuint16_t);
15854__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_u64)))
15855svuint64_t svabalb_u64(svuint64_t, svuint32_t, svuint32_t);
15856__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_u16)))
15857svuint16_t svabalb_u16(svuint16_t, svuint8_t, svuint8_t);
15858__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_n_s32)))
15859svint32_t svabalt_n_s32(svint32_t, svint16_t, int16_t);
15860__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_n_s64)))
15861svint64_t svabalt_n_s64(svint64_t, svint32_t, int32_t);
15862__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_n_s16)))
15863svint16_t svabalt_n_s16(svint16_t, svint8_t, int8_t);
15864__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_n_u32)))
15865svuint32_t svabalt_n_u32(svuint32_t, svuint16_t, uint16_t);
15866__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_n_u64)))
15867svuint64_t svabalt_n_u64(svuint64_t, svuint32_t, uint32_t);
15868__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_n_u16)))
15869svuint16_t svabalt_n_u16(svuint16_t, svuint8_t, uint8_t);
15870__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_s32)))
15871svint32_t svabalt_s32(svint32_t, svint16_t, svint16_t);
15872__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_s64)))
15873svint64_t svabalt_s64(svint64_t, svint32_t, svint32_t);
15874__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_s16)))
15875svint16_t svabalt_s16(svint16_t, svint8_t, svint8_t);
15876__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_u32)))
15877svuint32_t svabalt_u32(svuint32_t, svuint16_t, svuint16_t);
15878__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_u64)))
15879svuint64_t svabalt_u64(svuint64_t, svuint32_t, svuint32_t);
15880__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_u16)))
15881svuint16_t svabalt_u16(svuint16_t, svuint8_t, svuint8_t);
15882__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_n_s32)))
15883svint32_t svabdlb_n_s32(svint16_t, int16_t);
15884__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_n_s64)))
15885svint64_t svabdlb_n_s64(svint32_t, int32_t);
15886__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_n_s16)))
15887svint16_t svabdlb_n_s16(svint8_t, int8_t);
15888__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_n_u32)))
15889svuint32_t svabdlb_n_u32(svuint16_t, uint16_t);
15890__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_n_u64)))
15891svuint64_t svabdlb_n_u64(svuint32_t, uint32_t);
15892__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_n_u16)))
15893svuint16_t svabdlb_n_u16(svuint8_t, uint8_t);
15894__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_s32)))
15895svint32_t svabdlb_s32(svint16_t, svint16_t);
15896__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_s64)))
15897svint64_t svabdlb_s64(svint32_t, svint32_t);
15898__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_s16)))
15899svint16_t svabdlb_s16(svint8_t, svint8_t);
15900__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_u32)))
15901svuint32_t svabdlb_u32(svuint16_t, svuint16_t);
15902__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_u64)))
15903svuint64_t svabdlb_u64(svuint32_t, svuint32_t);
15904__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_u16)))
15905svuint16_t svabdlb_u16(svuint8_t, svuint8_t);
15906__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_n_s32)))
15907svint32_t svabdlt_n_s32(svint16_t, int16_t);
15908__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_n_s64)))
15909svint64_t svabdlt_n_s64(svint32_t, int32_t);
15910__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_n_s16)))
15911svint16_t svabdlt_n_s16(svint8_t, int8_t);
15912__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_n_u32)))
15913svuint32_t svabdlt_n_u32(svuint16_t, uint16_t);
15914__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_n_u64)))
15915svuint64_t svabdlt_n_u64(svuint32_t, uint32_t);
15916__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_n_u16)))
15917svuint16_t svabdlt_n_u16(svuint8_t, uint8_t);
15918__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_s32)))
15919svint32_t svabdlt_s32(svint16_t, svint16_t);
15920__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_s64)))
15921svint64_t svabdlt_s64(svint32_t, svint32_t);
15922__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_s16)))
15923svint16_t svabdlt_s16(svint8_t, svint8_t);
15924__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_u32)))
15925svuint32_t svabdlt_u32(svuint16_t, svuint16_t);
15926__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_u64)))
15927svuint64_t svabdlt_u64(svuint32_t, svuint32_t);
15928__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_u16)))
15929svuint16_t svabdlt_u16(svuint8_t, svuint8_t);
15930__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s32_m)))
15931svint32_t svadalp_s32_m(svbool_t, svint32_t, svint16_t);
15932__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s64_m)))
15933svint64_t svadalp_s64_m(svbool_t, svint64_t, svint32_t);
15934__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s16_m)))
15935svint16_t svadalp_s16_m(svbool_t, svint16_t, svint8_t);
15936__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s32_x)))
15937svint32_t svadalp_s32_x(svbool_t, svint32_t, svint16_t);
15938__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s64_x)))
15939svint64_t svadalp_s64_x(svbool_t, svint64_t, svint32_t);
15940__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s16_x)))
15941svint16_t svadalp_s16_x(svbool_t, svint16_t, svint8_t);
15942__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s32_z)))
15943svint32_t svadalp_s32_z(svbool_t, svint32_t, svint16_t);
15944__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s64_z)))
15945svint64_t svadalp_s64_z(svbool_t, svint64_t, svint32_t);
15946__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s16_z)))
15947svint16_t svadalp_s16_z(svbool_t, svint16_t, svint8_t);
15948__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u32_m)))
15949svuint32_t svadalp_u32_m(svbool_t, svuint32_t, svuint16_t);
15950__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u64_m)))
15951svuint64_t svadalp_u64_m(svbool_t, svuint64_t, svuint32_t);
15952__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u16_m)))
15953svuint16_t svadalp_u16_m(svbool_t, svuint16_t, svuint8_t);
15954__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u32_x)))
15955svuint32_t svadalp_u32_x(svbool_t, svuint32_t, svuint16_t);
15956__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u64_x)))
15957svuint64_t svadalp_u64_x(svbool_t, svuint64_t, svuint32_t);
15958__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u16_x)))
15959svuint16_t svadalp_u16_x(svbool_t, svuint16_t, svuint8_t);
15960__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u32_z)))
15961svuint32_t svadalp_u32_z(svbool_t, svuint32_t, svuint16_t);
15962__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u64_z)))
15963svuint64_t svadalp_u64_z(svbool_t, svuint64_t, svuint32_t);
15964__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u16_z)))
15965svuint16_t svadalp_u16_z(svbool_t, svuint16_t, svuint8_t);
15966__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclb_n_u32)))
15967svuint32_t svadclb_n_u32(svuint32_t, svuint32_t, uint32_t);
15968__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclb_n_u64)))
15969svuint64_t svadclb_n_u64(svuint64_t, svuint64_t, uint64_t);
15970__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclb_u32)))
15971svuint32_t svadclb_u32(svuint32_t, svuint32_t, svuint32_t);
15972__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclb_u64)))
15973svuint64_t svadclb_u64(svuint64_t, svuint64_t, svuint64_t);
15974__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclt_n_u32)))
15975svuint32_t svadclt_n_u32(svuint32_t, svuint32_t, uint32_t);
15976__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclt_n_u64)))
15977svuint64_t svadclt_n_u64(svuint64_t, svuint64_t, uint64_t);
15978__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclt_u32)))
15979svuint32_t svadclt_u32(svuint32_t, svuint32_t, svuint32_t);
15980__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclt_u64)))
15981svuint64_t svadclt_u64(svuint64_t, svuint64_t, svuint64_t);
15982__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_n_u32)))
15983svuint16_t svaddhnb_n_u32(svuint32_t, uint32_t);
15984__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_n_u64)))
15985svuint32_t svaddhnb_n_u64(svuint64_t, uint64_t);
15986__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_n_u16)))
15987svuint8_t svaddhnb_n_u16(svuint16_t, uint16_t);
15988__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_n_s32)))
15989svint16_t svaddhnb_n_s32(svint32_t, int32_t);
15990__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_n_s64)))
15991svint32_t svaddhnb_n_s64(svint64_t, int64_t);
15992__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_n_s16)))
15993svint8_t svaddhnb_n_s16(svint16_t, int16_t);
15994__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_u32)))
15995svuint16_t svaddhnb_u32(svuint32_t, svuint32_t);
15996__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_u64)))
15997svuint32_t svaddhnb_u64(svuint64_t, svuint64_t);
15998__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_u16)))
15999svuint8_t svaddhnb_u16(svuint16_t, svuint16_t);
16000__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_s32)))
16001svint16_t svaddhnb_s32(svint32_t, svint32_t);
16002__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_s64)))
16003svint32_t svaddhnb_s64(svint64_t, svint64_t);
16004__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_s16)))
16005svint8_t svaddhnb_s16(svint16_t, svint16_t);
16006__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_n_u32)))
16007svuint16_t svaddhnt_n_u32(svuint16_t, svuint32_t, uint32_t);
16008__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_n_u64)))
16009svuint32_t svaddhnt_n_u64(svuint32_t, svuint64_t, uint64_t);
16010__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_n_u16)))
16011svuint8_t svaddhnt_n_u16(svuint8_t, svuint16_t, uint16_t);
16012__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_n_s32)))
16013svint16_t svaddhnt_n_s32(svint16_t, svint32_t, int32_t);
16014__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_n_s64)))
16015svint32_t svaddhnt_n_s64(svint32_t, svint64_t, int64_t);
16016__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_n_s16)))
16017svint8_t svaddhnt_n_s16(svint8_t, svint16_t, int16_t);
16018__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_u32)))
16019svuint16_t svaddhnt_u32(svuint16_t, svuint32_t, svuint32_t);
16020__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_u64)))
16021svuint32_t svaddhnt_u64(svuint32_t, svuint64_t, svuint64_t);
16022__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_u16)))
16023svuint8_t svaddhnt_u16(svuint8_t, svuint16_t, svuint16_t);
16024__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_s32)))
16025svint16_t svaddhnt_s32(svint16_t, svint32_t, svint32_t);
16026__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_s64)))
16027svint32_t svaddhnt_s64(svint32_t, svint64_t, svint64_t);
16028__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_s16)))
16029svint8_t svaddhnt_s16(svint8_t, svint16_t, svint16_t);
16030__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_n_s32)))
16031svint32_t svaddlb_n_s32(svint16_t, int16_t);
16032__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_n_s64)))
16033svint64_t svaddlb_n_s64(svint32_t, int32_t);
16034__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_n_s16)))
16035svint16_t svaddlb_n_s16(svint8_t, int8_t);
16036__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_n_u32)))
16037svuint32_t svaddlb_n_u32(svuint16_t, uint16_t);
16038__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_n_u64)))
16039svuint64_t svaddlb_n_u64(svuint32_t, uint32_t);
16040__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_n_u16)))
16041svuint16_t svaddlb_n_u16(svuint8_t, uint8_t);
16042__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_s32)))
16043svint32_t svaddlb_s32(svint16_t, svint16_t);
16044__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_s64)))
16045svint64_t svaddlb_s64(svint32_t, svint32_t);
16046__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_s16)))
16047svint16_t svaddlb_s16(svint8_t, svint8_t);
16048__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_u32)))
16049svuint32_t svaddlb_u32(svuint16_t, svuint16_t);
16050__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_u64)))
16051svuint64_t svaddlb_u64(svuint32_t, svuint32_t);
16052__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_u16)))
16053svuint16_t svaddlb_u16(svuint8_t, svuint8_t);
16054__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlbt_n_s32)))
16055svint32_t svaddlbt_n_s32(svint16_t, int16_t);
16056__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlbt_n_s64)))
16057svint64_t svaddlbt_n_s64(svint32_t, int32_t);
16058__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlbt_n_s16)))
16059svint16_t svaddlbt_n_s16(svint8_t, int8_t);
16060__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlbt_s32)))
16061svint32_t svaddlbt_s32(svint16_t, svint16_t);
16062__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlbt_s64)))
16063svint64_t svaddlbt_s64(svint32_t, svint32_t);
16064__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlbt_s16)))
16065svint16_t svaddlbt_s16(svint8_t, svint8_t);
16066__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_n_s32)))
16067svint32_t svaddlt_n_s32(svint16_t, int16_t);
16068__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_n_s64)))
16069svint64_t svaddlt_n_s64(svint32_t, int32_t);
16070__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_n_s16)))
16071svint16_t svaddlt_n_s16(svint8_t, int8_t);
16072__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_n_u32)))
16073svuint32_t svaddlt_n_u32(svuint16_t, uint16_t);
16074__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_n_u64)))
16075svuint64_t svaddlt_n_u64(svuint32_t, uint32_t);
16076__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_n_u16)))
16077svuint16_t svaddlt_n_u16(svuint8_t, uint8_t);
16078__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_s32)))
16079svint32_t svaddlt_s32(svint16_t, svint16_t);
16080__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_s64)))
16081svint64_t svaddlt_s64(svint32_t, svint32_t);
16082__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_s16)))
16083svint16_t svaddlt_s16(svint8_t, svint8_t);
16084__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_u32)))
16085svuint32_t svaddlt_u32(svuint16_t, svuint16_t);
16086__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_u64)))
16087svuint64_t svaddlt_u64(svuint32_t, svuint32_t);
16088__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_u16)))
16089svuint16_t svaddlt_u16(svuint8_t, svuint8_t);
16090__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_f64_m)))
16091svfloat64_t svaddp_f64_m(svbool_t, svfloat64_t, svfloat64_t);
16092__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_f32_m)))
16093svfloat32_t svaddp_f32_m(svbool_t, svfloat32_t, svfloat32_t);
16094__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_f16_m)))
16095svfloat16_t svaddp_f16_m(svbool_t, svfloat16_t, svfloat16_t);
16096__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_f64_x)))
16097svfloat64_t svaddp_f64_x(svbool_t, svfloat64_t, svfloat64_t);
16098__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_f32_x)))
16099svfloat32_t svaddp_f32_x(svbool_t, svfloat32_t, svfloat32_t);
16100__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_f16_x)))
16101svfloat16_t svaddp_f16_x(svbool_t, svfloat16_t, svfloat16_t);
16102__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u8_m)))
16103svuint8_t svaddp_u8_m(svbool_t, svuint8_t, svuint8_t);
16104__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u32_m)))
16105svuint32_t svaddp_u32_m(svbool_t, svuint32_t, svuint32_t);
16106__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u64_m)))
16107svuint64_t svaddp_u64_m(svbool_t, svuint64_t, svuint64_t);
16108__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u16_m)))
16109svuint16_t svaddp_u16_m(svbool_t, svuint16_t, svuint16_t);
16110__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s8_m)))
16111svint8_t svaddp_s8_m(svbool_t, svint8_t, svint8_t);
16112__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s32_m)))
16113svint32_t svaddp_s32_m(svbool_t, svint32_t, svint32_t);
16114__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s64_m)))
16115svint64_t svaddp_s64_m(svbool_t, svint64_t, svint64_t);
16116__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s16_m)))
16117svint16_t svaddp_s16_m(svbool_t, svint16_t, svint16_t);
16118__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u8_x)))
16119svuint8_t svaddp_u8_x(svbool_t, svuint8_t, svuint8_t);
16120__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u32_x)))
16121svuint32_t svaddp_u32_x(svbool_t, svuint32_t, svuint32_t);
16122__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u64_x)))
16123svuint64_t svaddp_u64_x(svbool_t, svuint64_t, svuint64_t);
16124__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u16_x)))
16125svuint16_t svaddp_u16_x(svbool_t, svuint16_t, svuint16_t);
16126__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s8_x)))
16127svint8_t svaddp_s8_x(svbool_t, svint8_t, svint8_t);
16128__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s32_x)))
16129svint32_t svaddp_s32_x(svbool_t, svint32_t, svint32_t);
16130__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s64_x)))
16131svint64_t svaddp_s64_x(svbool_t, svint64_t, svint64_t);
16132__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s16_x)))
16133svint16_t svaddp_s16_x(svbool_t, svint16_t, svint16_t);
16134__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_n_s32)))
16135svint32_t svaddwb_n_s32(svint32_t, int16_t);
16136__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_n_s64)))
16137svint64_t svaddwb_n_s64(svint64_t, int32_t);
16138__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_n_s16)))
16139svint16_t svaddwb_n_s16(svint16_t, int8_t);
16140__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_n_u32)))
16141svuint32_t svaddwb_n_u32(svuint32_t, uint16_t);
16142__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_n_u64)))
16143svuint64_t svaddwb_n_u64(svuint64_t, uint32_t);
16144__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_n_u16)))
16145svuint16_t svaddwb_n_u16(svuint16_t, uint8_t);
16146__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_s32)))
16147svint32_t svaddwb_s32(svint32_t, svint16_t);
16148__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_s64)))
16149svint64_t svaddwb_s64(svint64_t, svint32_t);
16150__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_s16)))
16151svint16_t svaddwb_s16(svint16_t, svint8_t);
16152__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_u32)))
16153svuint32_t svaddwb_u32(svuint32_t, svuint16_t);
16154__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_u64)))
16155svuint64_t svaddwb_u64(svuint64_t, svuint32_t);
16156__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_u16)))
16157svuint16_t svaddwb_u16(svuint16_t, svuint8_t);
16158__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_n_s32)))
16159svint32_t svaddwt_n_s32(svint32_t, int16_t);
16160__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_n_s64)))
16161svint64_t svaddwt_n_s64(svint64_t, int32_t);
16162__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_n_s16)))
16163svint16_t svaddwt_n_s16(svint16_t, int8_t);
16164__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_n_u32)))
16165svuint32_t svaddwt_n_u32(svuint32_t, uint16_t);
16166__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_n_u64)))
16167svuint64_t svaddwt_n_u64(svuint64_t, uint32_t);
16168__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_n_u16)))
16169svuint16_t svaddwt_n_u16(svuint16_t, uint8_t);
16170__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_s32)))
16171svint32_t svaddwt_s32(svint32_t, svint16_t);
16172__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_s64)))
16173svint64_t svaddwt_s64(svint64_t, svint32_t);
16174__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_s16)))
16175svint16_t svaddwt_s16(svint16_t, svint8_t);
16176__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_u32)))
16177svuint32_t svaddwt_u32(svuint32_t, svuint16_t);
16178__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_u64)))
16179svuint64_t svaddwt_u64(svuint64_t, svuint32_t);
16180__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_u16)))
16181svuint16_t svaddwt_u16(svuint16_t, svuint8_t);
16182__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_u8)))
16183svuint8_t svbcax_n_u8(svuint8_t, svuint8_t, uint8_t);
16184__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_u32)))
16185svuint32_t svbcax_n_u32(svuint32_t, svuint32_t, uint32_t);
16186__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_u64)))
16187svuint64_t svbcax_n_u64(svuint64_t, svuint64_t, uint64_t);
16188__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_u16)))
16189svuint16_t svbcax_n_u16(svuint16_t, svuint16_t, uint16_t);
16190__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_s8)))
16191svint8_t svbcax_n_s8(svint8_t, svint8_t, int8_t);
16192__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_s32)))
16193svint32_t svbcax_n_s32(svint32_t, svint32_t, int32_t);
16194__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_s64)))
16195svint64_t svbcax_n_s64(svint64_t, svint64_t, int64_t);
16196__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_s16)))
16197svint16_t svbcax_n_s16(svint16_t, svint16_t, int16_t);
16198__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_u8)))
16199svuint8_t svbcax_u8(svuint8_t, svuint8_t, svuint8_t);
16200__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_u32)))
16201svuint32_t svbcax_u32(svuint32_t, svuint32_t, svuint32_t);
16202__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_u64)))
16203svuint64_t svbcax_u64(svuint64_t, svuint64_t, svuint64_t);
16204__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_u16)))
16205svuint16_t svbcax_u16(svuint16_t, svuint16_t, svuint16_t);
16206__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_s8)))
16207svint8_t svbcax_s8(svint8_t, svint8_t, svint8_t);
16208__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_s32)))
16209svint32_t svbcax_s32(svint32_t, svint32_t, svint32_t);
16210__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_s64)))
16211svint64_t svbcax_s64(svint64_t, svint64_t, svint64_t);
16212__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_s16)))
16213svint16_t svbcax_s16(svint16_t, svint16_t, svint16_t);
16214__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_u8)))
16215svuint8_t svbsl1n_n_u8(svuint8_t, svuint8_t, uint8_t);
16216__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_u32)))
16217svuint32_t svbsl1n_n_u32(svuint32_t, svuint32_t, uint32_t);
16218__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_u64)))
16219svuint64_t svbsl1n_n_u64(svuint64_t, svuint64_t, uint64_t);
16220__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_u16)))
16221svuint16_t svbsl1n_n_u16(svuint16_t, svuint16_t, uint16_t);
16222__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_s8)))
16223svint8_t svbsl1n_n_s8(svint8_t, svint8_t, int8_t);
16224__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_s32)))
16225svint32_t svbsl1n_n_s32(svint32_t, svint32_t, int32_t);
16226__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_s64)))
16227svint64_t svbsl1n_n_s64(svint64_t, svint64_t, int64_t);
16228__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_s16)))
16229svint16_t svbsl1n_n_s16(svint16_t, svint16_t, int16_t);
16230__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_u8)))
16231svuint8_t svbsl1n_u8(svuint8_t, svuint8_t, svuint8_t);
16232__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_u32)))
16233svuint32_t svbsl1n_u32(svuint32_t, svuint32_t, svuint32_t);
16234__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_u64)))
16235svuint64_t svbsl1n_u64(svuint64_t, svuint64_t, svuint64_t);
16236__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_u16)))
16237svuint16_t svbsl1n_u16(svuint16_t, svuint16_t, svuint16_t);
16238__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_s8)))
16239svint8_t svbsl1n_s8(svint8_t, svint8_t, svint8_t);
16240__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_s32)))
16241svint32_t svbsl1n_s32(svint32_t, svint32_t, svint32_t);
16242__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_s64)))
16243svint64_t svbsl1n_s64(svint64_t, svint64_t, svint64_t);
16244__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_s16)))
16245svint16_t svbsl1n_s16(svint16_t, svint16_t, svint16_t);
16246__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_u8)))
16247svuint8_t svbsl2n_n_u8(svuint8_t, svuint8_t, uint8_t);
16248__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_u32)))
16249svuint32_t svbsl2n_n_u32(svuint32_t, svuint32_t, uint32_t);
16250__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_u64)))
16251svuint64_t svbsl2n_n_u64(svuint64_t, svuint64_t, uint64_t);
16252__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_u16)))
16253svuint16_t svbsl2n_n_u16(svuint16_t, svuint16_t, uint16_t);
16254__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_s8)))
16255svint8_t svbsl2n_n_s8(svint8_t, svint8_t, int8_t);
16256__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_s32)))
16257svint32_t svbsl2n_n_s32(svint32_t, svint32_t, int32_t);
16258__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_s64)))
16259svint64_t svbsl2n_n_s64(svint64_t, svint64_t, int64_t);
16260__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_s16)))
16261svint16_t svbsl2n_n_s16(svint16_t, svint16_t, int16_t);
16262__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_u8)))
16263svuint8_t svbsl2n_u8(svuint8_t, svuint8_t, svuint8_t);
16264__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_u32)))
16265svuint32_t svbsl2n_u32(svuint32_t, svuint32_t, svuint32_t);
16266__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_u64)))
16267svuint64_t svbsl2n_u64(svuint64_t, svuint64_t, svuint64_t);
16268__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_u16)))
16269svuint16_t svbsl2n_u16(svuint16_t, svuint16_t, svuint16_t);
16270__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_s8)))
16271svint8_t svbsl2n_s8(svint8_t, svint8_t, svint8_t);
16272__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_s32)))
16273svint32_t svbsl2n_s32(svint32_t, svint32_t, svint32_t);
16274__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_s64)))
16275svint64_t svbsl2n_s64(svint64_t, svint64_t, svint64_t);
16276__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_s16)))
16277svint16_t svbsl2n_s16(svint16_t, svint16_t, svint16_t);
16278__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_u8)))
16279svuint8_t svbsl_n_u8(svuint8_t, svuint8_t, uint8_t);
16280__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_u32)))
16281svuint32_t svbsl_n_u32(svuint32_t, svuint32_t, uint32_t);
16282__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_u64)))
16283svuint64_t svbsl_n_u64(svuint64_t, svuint64_t, uint64_t);
16284__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_u16)))
16285svuint16_t svbsl_n_u16(svuint16_t, svuint16_t, uint16_t);
16286__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_s8)))
16287svint8_t svbsl_n_s8(svint8_t, svint8_t, int8_t);
16288__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_s32)))
16289svint32_t svbsl_n_s32(svint32_t, svint32_t, int32_t);
16290__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_s64)))
16291svint64_t svbsl_n_s64(svint64_t, svint64_t, int64_t);
16292__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_s16)))
16293svint16_t svbsl_n_s16(svint16_t, svint16_t, int16_t);
16294__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_u8)))
16295svuint8_t svbsl_u8(svuint8_t, svuint8_t, svuint8_t);
16296__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_u32)))
16297svuint32_t svbsl_u32(svuint32_t, svuint32_t, svuint32_t);
16298__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_u64)))
16299svuint64_t svbsl_u64(svuint64_t, svuint64_t, svuint64_t);
16300__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_u16)))
16301svuint16_t svbsl_u16(svuint16_t, svuint16_t, svuint16_t);
16302__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_s8)))
16303svint8_t svbsl_s8(svint8_t, svint8_t, svint8_t);
16304__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_s32)))
16305svint32_t svbsl_s32(svint32_t, svint32_t, svint32_t);
16306__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_s64)))
16307svint64_t svbsl_s64(svint64_t, svint64_t, svint64_t);
16308__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_s16)))
16309svint16_t svbsl_s16(svint16_t, svint16_t, svint16_t);
16310__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_u8)))
16311svuint8_t svcadd_u8(svuint8_t, svuint8_t, uint64_t);
16312__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_u32)))
16313svuint32_t svcadd_u32(svuint32_t, svuint32_t, uint64_t);
16314__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_u64)))
16315svuint64_t svcadd_u64(svuint64_t, svuint64_t, uint64_t);
16316__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_u16)))
16317svuint16_t svcadd_u16(svuint16_t, svuint16_t, uint64_t);
16318__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_s8)))
16319svint8_t svcadd_s8(svint8_t, svint8_t, uint64_t);
16320__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_s32)))
16321svint32_t svcadd_s32(svint32_t, svint32_t, uint64_t);
16322__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_s64)))
16323svint64_t svcadd_s64(svint64_t, svint64_t, uint64_t);
16324__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_s16)))
16325svint16_t svcadd_s16(svint16_t, svint16_t, uint64_t);
16326__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcdot_s32)))
16327svint32_t svcdot_s32(svint32_t, svint8_t, svint8_t, uint64_t);
16328__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcdot_s64)))
16329svint64_t svcdot_s64(svint64_t, svint16_t, svint16_t, uint64_t);
16330__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcdot_lane_s32)))
16331svint32_t svcdot_lane_s32(svint32_t, svint8_t, svint8_t, uint64_t, uint64_t);
16332__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcdot_lane_s64)))
16333svint64_t svcdot_lane_s64(svint64_t, svint16_t, svint16_t, uint64_t, uint64_t);
16334__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_u8)))
16335svuint8_t svcmla_u8(svuint8_t, svuint8_t, svuint8_t, uint64_t);
16336__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_u32)))
16337svuint32_t svcmla_u32(svuint32_t, svuint32_t, svuint32_t, uint64_t);
16338__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_u64)))
16339svuint64_t svcmla_u64(svuint64_t, svuint64_t, svuint64_t, uint64_t);
16340__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_u16)))
16341svuint16_t svcmla_u16(svuint16_t, svuint16_t, svuint16_t, uint64_t);
16342__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_s8)))
16343svint8_t svcmla_s8(svint8_t, svint8_t, svint8_t, uint64_t);
16344__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_s32)))
16345svint32_t svcmla_s32(svint32_t, svint32_t, svint32_t, uint64_t);
16346__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_s64)))
16347svint64_t svcmla_s64(svint64_t, svint64_t, svint64_t, uint64_t);
16348__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_s16)))
16349svint16_t svcmla_s16(svint16_t, svint16_t, svint16_t, uint64_t);
16350__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_lane_u32)))
16351svuint32_t svcmla_lane_u32(svuint32_t, svuint32_t, svuint32_t, uint64_t, uint64_t);
16352__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_lane_u16)))
16353svuint16_t svcmla_lane_u16(svuint16_t, svuint16_t, svuint16_t, uint64_t, uint64_t);
16354__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_lane_s32)))
16355svint32_t svcmla_lane_s32(svint32_t, svint32_t, svint32_t, uint64_t, uint64_t);
16356__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_lane_s16)))
16357svint16_t svcmla_lane_s16(svint16_t, svint16_t, svint16_t, uint64_t, uint64_t);
16358__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtlt_f32_f16_m)))
16359svfloat32_t svcvtlt_f32_f16_m(svfloat32_t, svbool_t, svfloat16_t);
16360__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtlt_f32_f16_x)))
16361svfloat32_t svcvtlt_f32_f16_x(svbool_t, svfloat16_t);
16362__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtlt_f64_f32_m)))
16363svfloat64_t svcvtlt_f64_f32_m(svfloat64_t, svbool_t, svfloat32_t);
16364__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtlt_f64_f32_x)))
16365svfloat64_t svcvtlt_f64_f32_x(svbool_t, svfloat32_t);
16366__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtnt_f16_f32_m)))
16367svfloat16_t svcvtnt_f16_f32_m(svfloat16_t, svbool_t, svfloat32_t);
16368__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtnt_f32_f64_m)))
16369svfloat32_t svcvtnt_f32_f64_m(svfloat32_t, svbool_t, svfloat64_t);
16370__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtx_f32_f64_m)))
16371svfloat32_t svcvtx_f32_f64_m(svfloat32_t, svbool_t, svfloat64_t);
16372__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtx_f32_f64_x)))
16373svfloat32_t svcvtx_f32_f64_x(svbool_t, svfloat64_t);
16374__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtx_f32_f64_z)))
16375svfloat32_t svcvtx_f32_f64_z(svbool_t, svfloat64_t);
16376__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtxnt_f32_f64_m)))
16377svfloat32_t svcvtxnt_f32_f64_m(svfloat32_t, svbool_t, svfloat64_t);
16378__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_u8)))
16379svuint8_t sveor3_n_u8(svuint8_t, svuint8_t, uint8_t);
16380__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_u32)))
16381svuint32_t sveor3_n_u32(svuint32_t, svuint32_t, uint32_t);
16382__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_u64)))
16383svuint64_t sveor3_n_u64(svuint64_t, svuint64_t, uint64_t);
16384__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_u16)))
16385svuint16_t sveor3_n_u16(svuint16_t, svuint16_t, uint16_t);
16386__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_s8)))
16387svint8_t sveor3_n_s8(svint8_t, svint8_t, int8_t);
16388__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_s32)))
16389svint32_t sveor3_n_s32(svint32_t, svint32_t, int32_t);
16390__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_s64)))
16391svint64_t sveor3_n_s64(svint64_t, svint64_t, int64_t);
16392__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_s16)))
16393svint16_t sveor3_n_s16(svint16_t, svint16_t, int16_t);
16394__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_u8)))
16395svuint8_t sveor3_u8(svuint8_t, svuint8_t, svuint8_t);
16396__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_u32)))
16397svuint32_t sveor3_u32(svuint32_t, svuint32_t, svuint32_t);
16398__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_u64)))
16399svuint64_t sveor3_u64(svuint64_t, svuint64_t, svuint64_t);
16400__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_u16)))
16401svuint16_t sveor3_u16(svuint16_t, svuint16_t, svuint16_t);
16402__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_s8)))
16403svint8_t sveor3_s8(svint8_t, svint8_t, svint8_t);
16404__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_s32)))
16405svint32_t sveor3_s32(svint32_t, svint32_t, svint32_t);
16406__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_s64)))
16407svint64_t sveor3_s64(svint64_t, svint64_t, svint64_t);
16408__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_s16)))
16409svint16_t sveor3_s16(svint16_t, svint16_t, svint16_t);
16410__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_u8)))
16411svuint8_t sveorbt_n_u8(svuint8_t, svuint8_t, uint8_t);
16412__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_u32)))
16413svuint32_t sveorbt_n_u32(svuint32_t, svuint32_t, uint32_t);
16414__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_u64)))
16415svuint64_t sveorbt_n_u64(svuint64_t, svuint64_t, uint64_t);
16416__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_u16)))
16417svuint16_t sveorbt_n_u16(svuint16_t, svuint16_t, uint16_t);
16418__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_s8)))
16419svint8_t sveorbt_n_s8(svint8_t, svint8_t, int8_t);
16420__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_s32)))
16421svint32_t sveorbt_n_s32(svint32_t, svint32_t, int32_t);
16422__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_s64)))
16423svint64_t sveorbt_n_s64(svint64_t, svint64_t, int64_t);
16424__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_s16)))
16425svint16_t sveorbt_n_s16(svint16_t, svint16_t, int16_t);
16426__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_u8)))
16427svuint8_t sveorbt_u8(svuint8_t, svuint8_t, svuint8_t);
16428__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_u32)))
16429svuint32_t sveorbt_u32(svuint32_t, svuint32_t, svuint32_t);
16430__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_u64)))
16431svuint64_t sveorbt_u64(svuint64_t, svuint64_t, svuint64_t);
16432__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_u16)))
16433svuint16_t sveorbt_u16(svuint16_t, svuint16_t, svuint16_t);
16434__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_s8)))
16435svint8_t sveorbt_s8(svint8_t, svint8_t, svint8_t);
16436__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_s32)))
16437svint32_t sveorbt_s32(svint32_t, svint32_t, svint32_t);
16438__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_s64)))
16439svint64_t sveorbt_s64(svint64_t, svint64_t, svint64_t);
16440__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_s16)))
16441svint16_t sveorbt_s16(svint16_t, svint16_t, svint16_t);
16442__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_u8)))
16443svuint8_t sveortb_n_u8(svuint8_t, svuint8_t, uint8_t);
16444__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_u32)))
16445svuint32_t sveortb_n_u32(svuint32_t, svuint32_t, uint32_t);
16446__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_u64)))
16447svuint64_t sveortb_n_u64(svuint64_t, svuint64_t, uint64_t);
16448__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_u16)))
16449svuint16_t sveortb_n_u16(svuint16_t, svuint16_t, uint16_t);
16450__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_s8)))
16451svint8_t sveortb_n_s8(svint8_t, svint8_t, int8_t);
16452__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_s32)))
16453svint32_t sveortb_n_s32(svint32_t, svint32_t, int32_t);
16454__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_s64)))
16455svint64_t sveortb_n_s64(svint64_t, svint64_t, int64_t);
16456__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_s16)))
16457svint16_t sveortb_n_s16(svint16_t, svint16_t, int16_t);
16458__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_u8)))
16459svuint8_t sveortb_u8(svuint8_t, svuint8_t, svuint8_t);
16460__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_u32)))
16461svuint32_t sveortb_u32(svuint32_t, svuint32_t, svuint32_t);
16462__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_u64)))
16463svuint64_t sveortb_u64(svuint64_t, svuint64_t, svuint64_t);
16464__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_u16)))
16465svuint16_t sveortb_u16(svuint16_t, svuint16_t, svuint16_t);
16466__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_s8)))
16467svint8_t sveortb_s8(svint8_t, svint8_t, svint8_t);
16468__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_s32)))
16469svint32_t sveortb_s32(svint32_t, svint32_t, svint32_t);
16470__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_s64)))
16471svint64_t sveortb_s64(svint64_t, svint64_t, svint64_t);
16472__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_s16)))
16473svint16_t sveortb_s16(svint16_t, svint16_t, svint16_t);
16474__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s8_m)))
16475svint8_t svhadd_n_s8_m(svbool_t, svint8_t, int8_t);
16476__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s32_m)))
16477svint32_t svhadd_n_s32_m(svbool_t, svint32_t, int32_t);
16478__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s64_m)))
16479svint64_t svhadd_n_s64_m(svbool_t, svint64_t, int64_t);
16480__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s16_m)))
16481svint16_t svhadd_n_s16_m(svbool_t, svint16_t, int16_t);
16482__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s8_x)))
16483svint8_t svhadd_n_s8_x(svbool_t, svint8_t, int8_t);
16484__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s32_x)))
16485svint32_t svhadd_n_s32_x(svbool_t, svint32_t, int32_t);
16486__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s64_x)))
16487svint64_t svhadd_n_s64_x(svbool_t, svint64_t, int64_t);
16488__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s16_x)))
16489svint16_t svhadd_n_s16_x(svbool_t, svint16_t, int16_t);
16490__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s8_z)))
16491svint8_t svhadd_n_s8_z(svbool_t, svint8_t, int8_t);
16492__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s32_z)))
16493svint32_t svhadd_n_s32_z(svbool_t, svint32_t, int32_t);
16494__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s64_z)))
16495svint64_t svhadd_n_s64_z(svbool_t, svint64_t, int64_t);
16496__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s16_z)))
16497svint16_t svhadd_n_s16_z(svbool_t, svint16_t, int16_t);
16498__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u8_m)))
16499svuint8_t svhadd_n_u8_m(svbool_t, svuint8_t, uint8_t);
16500__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u32_m)))
16501svuint32_t svhadd_n_u32_m(svbool_t, svuint32_t, uint32_t);
16502__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u64_m)))
16503svuint64_t svhadd_n_u64_m(svbool_t, svuint64_t, uint64_t);
16504__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u16_m)))
16505svuint16_t svhadd_n_u16_m(svbool_t, svuint16_t, uint16_t);
16506__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u8_x)))
16507svuint8_t svhadd_n_u8_x(svbool_t, svuint8_t, uint8_t);
16508__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u32_x)))
16509svuint32_t svhadd_n_u32_x(svbool_t, svuint32_t, uint32_t);
16510__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u64_x)))
16511svuint64_t svhadd_n_u64_x(svbool_t, svuint64_t, uint64_t);
16512__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u16_x)))
16513svuint16_t svhadd_n_u16_x(svbool_t, svuint16_t, uint16_t);
16514__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u8_z)))
16515svuint8_t svhadd_n_u8_z(svbool_t, svuint8_t, uint8_t);
16516__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u32_z)))
16517svuint32_t svhadd_n_u32_z(svbool_t, svuint32_t, uint32_t);
16518__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u64_z)))
16519svuint64_t svhadd_n_u64_z(svbool_t, svuint64_t, uint64_t);
16520__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u16_z)))
16521svuint16_t svhadd_n_u16_z(svbool_t, svuint16_t, uint16_t);
16522__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s8_m)))
16523svint8_t svhadd_s8_m(svbool_t, svint8_t, svint8_t);
16524__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s32_m)))
16525svint32_t svhadd_s32_m(svbool_t, svint32_t, svint32_t);
16526__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s64_m)))
16527svint64_t svhadd_s64_m(svbool_t, svint64_t, svint64_t);
16528__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s16_m)))
16529svint16_t svhadd_s16_m(svbool_t, svint16_t, svint16_t);
16530__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s8_x)))
16531svint8_t svhadd_s8_x(svbool_t, svint8_t, svint8_t);
16532__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s32_x)))
16533svint32_t svhadd_s32_x(svbool_t, svint32_t, svint32_t);
16534__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s64_x)))
16535svint64_t svhadd_s64_x(svbool_t, svint64_t, svint64_t);
16536__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s16_x)))
16537svint16_t svhadd_s16_x(svbool_t, svint16_t, svint16_t);
16538__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s8_z)))
16539svint8_t svhadd_s8_z(svbool_t, svint8_t, svint8_t);
16540__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s32_z)))
16541svint32_t svhadd_s32_z(svbool_t, svint32_t, svint32_t);
16542__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s64_z)))
16543svint64_t svhadd_s64_z(svbool_t, svint64_t, svint64_t);
16544__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s16_z)))
16545svint16_t svhadd_s16_z(svbool_t, svint16_t, svint16_t);
16546__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u8_m)))
16547svuint8_t svhadd_u8_m(svbool_t, svuint8_t, svuint8_t);
16548__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u32_m)))
16549svuint32_t svhadd_u32_m(svbool_t, svuint32_t, svuint32_t);
16550__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u64_m)))
16551svuint64_t svhadd_u64_m(svbool_t, svuint64_t, svuint64_t);
16552__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u16_m)))
16553svuint16_t svhadd_u16_m(svbool_t, svuint16_t, svuint16_t);
16554__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u8_x)))
16555svuint8_t svhadd_u8_x(svbool_t, svuint8_t, svuint8_t);
16556__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u32_x)))
16557svuint32_t svhadd_u32_x(svbool_t, svuint32_t, svuint32_t);
16558__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u64_x)))
16559svuint64_t svhadd_u64_x(svbool_t, svuint64_t, svuint64_t);
16560__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u16_x)))
16561svuint16_t svhadd_u16_x(svbool_t, svuint16_t, svuint16_t);
16562__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u8_z)))
16563svuint8_t svhadd_u8_z(svbool_t, svuint8_t, svuint8_t);
16564__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u32_z)))
16565svuint32_t svhadd_u32_z(svbool_t, svuint32_t, svuint32_t);
16566__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u64_z)))
16567svuint64_t svhadd_u64_z(svbool_t, svuint64_t, svuint64_t);
16568__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u16_z)))
16569svuint16_t svhadd_u16_z(svbool_t, svuint16_t, svuint16_t);
16570__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhistcnt_u32_z)))
16571svuint32_t svhistcnt_u32_z(svbool_t, svuint32_t, svuint32_t);
16572__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhistcnt_u64_z)))
16573svuint64_t svhistcnt_u64_z(svbool_t, svuint64_t, svuint64_t);
16574__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhistcnt_s32_z)))
16575svuint32_t svhistcnt_s32_z(svbool_t, svint32_t, svint32_t);
16576__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhistcnt_s64_z)))
16577svuint64_t svhistcnt_s64_z(svbool_t, svint64_t, svint64_t);
16578__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhistseg_u8)))
16579svuint8_t svhistseg_u8(svuint8_t, svuint8_t);
16580__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhistseg_s8)))
16581svuint8_t svhistseg_s8(svint8_t, svint8_t);
16582__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s8_m)))
16583svint8_t svhsub_n_s8_m(svbool_t, svint8_t, int8_t);
16584__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s32_m)))
16585svint32_t svhsub_n_s32_m(svbool_t, svint32_t, int32_t);
16586__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s64_m)))
16587svint64_t svhsub_n_s64_m(svbool_t, svint64_t, int64_t);
16588__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s16_m)))
16589svint16_t svhsub_n_s16_m(svbool_t, svint16_t, int16_t);
16590__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s8_x)))
16591svint8_t svhsub_n_s8_x(svbool_t, svint8_t, int8_t);
16592__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s32_x)))
16593svint32_t svhsub_n_s32_x(svbool_t, svint32_t, int32_t);
16594__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s64_x)))
16595svint64_t svhsub_n_s64_x(svbool_t, svint64_t, int64_t);
16596__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s16_x)))
16597svint16_t svhsub_n_s16_x(svbool_t, svint16_t, int16_t);
16598__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s8_z)))
16599svint8_t svhsub_n_s8_z(svbool_t, svint8_t, int8_t);
16600__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s32_z)))
16601svint32_t svhsub_n_s32_z(svbool_t, svint32_t, int32_t);
16602__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s64_z)))
16603svint64_t svhsub_n_s64_z(svbool_t, svint64_t, int64_t);
16604__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s16_z)))
16605svint16_t svhsub_n_s16_z(svbool_t, svint16_t, int16_t);
16606__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u8_m)))
16607svuint8_t svhsub_n_u8_m(svbool_t, svuint8_t, uint8_t);
16608__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u32_m)))
16609svuint32_t svhsub_n_u32_m(svbool_t, svuint32_t, uint32_t);
16610__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u64_m)))
16611svuint64_t svhsub_n_u64_m(svbool_t, svuint64_t, uint64_t);
16612__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u16_m)))
16613svuint16_t svhsub_n_u16_m(svbool_t, svuint16_t, uint16_t);
16614__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u8_x)))
16615svuint8_t svhsub_n_u8_x(svbool_t, svuint8_t, uint8_t);
16616__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u32_x)))
16617svuint32_t svhsub_n_u32_x(svbool_t, svuint32_t, uint32_t);
16618__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u64_x)))
16619svuint64_t svhsub_n_u64_x(svbool_t, svuint64_t, uint64_t);
16620__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u16_x)))
16621svuint16_t svhsub_n_u16_x(svbool_t, svuint16_t, uint16_t);
16622__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u8_z)))
16623svuint8_t svhsub_n_u8_z(svbool_t, svuint8_t, uint8_t);
16624__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u32_z)))
16625svuint32_t svhsub_n_u32_z(svbool_t, svuint32_t, uint32_t);
16626__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u64_z)))
16627svuint64_t svhsub_n_u64_z(svbool_t, svuint64_t, uint64_t);
16628__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u16_z)))
16629svuint16_t svhsub_n_u16_z(svbool_t, svuint16_t, uint16_t);
16630__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s8_m)))
16631svint8_t svhsub_s8_m(svbool_t, svint8_t, svint8_t);
16632__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s32_m)))
16633svint32_t svhsub_s32_m(svbool_t, svint32_t, svint32_t);
16634__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s64_m)))
16635svint64_t svhsub_s64_m(svbool_t, svint64_t, svint64_t);
16636__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s16_m)))
16637svint16_t svhsub_s16_m(svbool_t, svint16_t, svint16_t);
16638__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s8_x)))
16639svint8_t svhsub_s8_x(svbool_t, svint8_t, svint8_t);
16640__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s32_x)))
16641svint32_t svhsub_s32_x(svbool_t, svint32_t, svint32_t);
16642__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s64_x)))
16643svint64_t svhsub_s64_x(svbool_t, svint64_t, svint64_t);
16644__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s16_x)))
16645svint16_t svhsub_s16_x(svbool_t, svint16_t, svint16_t);
16646__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s8_z)))
16647svint8_t svhsub_s8_z(svbool_t, svint8_t, svint8_t);
16648__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s32_z)))
16649svint32_t svhsub_s32_z(svbool_t, svint32_t, svint32_t);
16650__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s64_z)))
16651svint64_t svhsub_s64_z(svbool_t, svint64_t, svint64_t);
16652__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s16_z)))
16653svint16_t svhsub_s16_z(svbool_t, svint16_t, svint16_t);
16654__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u8_m)))
16655svuint8_t svhsub_u8_m(svbool_t, svuint8_t, svuint8_t);
16656__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u32_m)))
16657svuint32_t svhsub_u32_m(svbool_t, svuint32_t, svuint32_t);
16658__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u64_m)))
16659svuint64_t svhsub_u64_m(svbool_t, svuint64_t, svuint64_t);
16660__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u16_m)))
16661svuint16_t svhsub_u16_m(svbool_t, svuint16_t, svuint16_t);
16662__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u8_x)))
16663svuint8_t svhsub_u8_x(svbool_t, svuint8_t, svuint8_t);
16664__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u32_x)))
16665svuint32_t svhsub_u32_x(svbool_t, svuint32_t, svuint32_t);
16666__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u64_x)))
16667svuint64_t svhsub_u64_x(svbool_t, svuint64_t, svuint64_t);
16668__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u16_x)))
16669svuint16_t svhsub_u16_x(svbool_t, svuint16_t, svuint16_t);
16670__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u8_z)))
16671svuint8_t svhsub_u8_z(svbool_t, svuint8_t, svuint8_t);
16672__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u32_z)))
16673svuint32_t svhsub_u32_z(svbool_t, svuint32_t, svuint32_t);
16674__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u64_z)))
16675svuint64_t svhsub_u64_z(svbool_t, svuint64_t, svuint64_t);
16676__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u16_z)))
16677svuint16_t svhsub_u16_z(svbool_t, svuint16_t, svuint16_t);
16678__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s8_m)))
16679svint8_t svhsubr_n_s8_m(svbool_t, svint8_t, int8_t);
16680__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s32_m)))
16681svint32_t svhsubr_n_s32_m(svbool_t, svint32_t, int32_t);
16682__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s64_m)))
16683svint64_t svhsubr_n_s64_m(svbool_t, svint64_t, int64_t);
16684__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s16_m)))
16685svint16_t svhsubr_n_s16_m(svbool_t, svint16_t, int16_t);
16686__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s8_x)))
16687svint8_t svhsubr_n_s8_x(svbool_t, svint8_t, int8_t);
16688__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s32_x)))
16689svint32_t svhsubr_n_s32_x(svbool_t, svint32_t, int32_t);
16690__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s64_x)))
16691svint64_t svhsubr_n_s64_x(svbool_t, svint64_t, int64_t);
16692__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s16_x)))
16693svint16_t svhsubr_n_s16_x(svbool_t, svint16_t, int16_t);
16694__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s8_z)))
16695svint8_t svhsubr_n_s8_z(svbool_t, svint8_t, int8_t);
16696__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s32_z)))
16697svint32_t svhsubr_n_s32_z(svbool_t, svint32_t, int32_t);
16698__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s64_z)))
16699svint64_t svhsubr_n_s64_z(svbool_t, svint64_t, int64_t);
16700__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s16_z)))
16701svint16_t svhsubr_n_s16_z(svbool_t, svint16_t, int16_t);
16702__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u8_m)))
16703svuint8_t svhsubr_n_u8_m(svbool_t, svuint8_t, uint8_t);
16704__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u32_m)))
16705svuint32_t svhsubr_n_u32_m(svbool_t, svuint32_t, uint32_t);
16706__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u64_m)))
16707svuint64_t svhsubr_n_u64_m(svbool_t, svuint64_t, uint64_t);
16708__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u16_m)))
16709svuint16_t svhsubr_n_u16_m(svbool_t, svuint16_t, uint16_t);
16710__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u8_x)))
16711svuint8_t svhsubr_n_u8_x(svbool_t, svuint8_t, uint8_t);
16712__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u32_x)))
16713svuint32_t svhsubr_n_u32_x(svbool_t, svuint32_t, uint32_t);
16714__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u64_x)))
16715svuint64_t svhsubr_n_u64_x(svbool_t, svuint64_t, uint64_t);
16716__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u16_x)))
16717svuint16_t svhsubr_n_u16_x(svbool_t, svuint16_t, uint16_t);
16718__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u8_z)))
16719svuint8_t svhsubr_n_u8_z(svbool_t, svuint8_t, uint8_t);
16720__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u32_z)))
16721svuint32_t svhsubr_n_u32_z(svbool_t, svuint32_t, uint32_t);
16722__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u64_z)))
16723svuint64_t svhsubr_n_u64_z(svbool_t, svuint64_t, uint64_t);
16724__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u16_z)))
16725svuint16_t svhsubr_n_u16_z(svbool_t, svuint16_t, uint16_t);
16726__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s8_m)))
16727svint8_t svhsubr_s8_m(svbool_t, svint8_t, svint8_t);
16728__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s32_m)))
16729svint32_t svhsubr_s32_m(svbool_t, svint32_t, svint32_t);
16730__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s64_m)))
16731svint64_t svhsubr_s64_m(svbool_t, svint64_t, svint64_t);
16732__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s16_m)))
16733svint16_t svhsubr_s16_m(svbool_t, svint16_t, svint16_t);
16734__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s8_x)))
16735svint8_t svhsubr_s8_x(svbool_t, svint8_t, svint8_t);
16736__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s32_x)))
16737svint32_t svhsubr_s32_x(svbool_t, svint32_t, svint32_t);
16738__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s64_x)))
16739svint64_t svhsubr_s64_x(svbool_t, svint64_t, svint64_t);
16740__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s16_x)))
16741svint16_t svhsubr_s16_x(svbool_t, svint16_t, svint16_t);
16742__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s8_z)))
16743svint8_t svhsubr_s8_z(svbool_t, svint8_t, svint8_t);
16744__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s32_z)))
16745svint32_t svhsubr_s32_z(svbool_t, svint32_t, svint32_t);
16746__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s64_z)))
16747svint64_t svhsubr_s64_z(svbool_t, svint64_t, svint64_t);
16748__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s16_z)))
16749svint16_t svhsubr_s16_z(svbool_t, svint16_t, svint16_t);
16750__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u8_m)))
16751svuint8_t svhsubr_u8_m(svbool_t, svuint8_t, svuint8_t);
16752__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u32_m)))
16753svuint32_t svhsubr_u32_m(svbool_t, svuint32_t, svuint32_t);
16754__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u64_m)))
16755svuint64_t svhsubr_u64_m(svbool_t, svuint64_t, svuint64_t);
16756__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u16_m)))
16757svuint16_t svhsubr_u16_m(svbool_t, svuint16_t, svuint16_t);
16758__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u8_x)))
16759svuint8_t svhsubr_u8_x(svbool_t, svuint8_t, svuint8_t);
16760__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u32_x)))
16761svuint32_t svhsubr_u32_x(svbool_t, svuint32_t, svuint32_t);
16762__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u64_x)))
16763svuint64_t svhsubr_u64_x(svbool_t, svuint64_t, svuint64_t);
16764__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u16_x)))
16765svuint16_t svhsubr_u16_x(svbool_t, svuint16_t, svuint16_t);
16766__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u8_z)))
16767svuint8_t svhsubr_u8_z(svbool_t, svuint8_t, svuint8_t);
16768__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u32_z)))
16769svuint32_t svhsubr_u32_z(svbool_t, svuint32_t, svuint32_t);
16770__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u64_z)))
16771svuint64_t svhsubr_u64_z(svbool_t, svuint64_t, svuint64_t);
16772__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u16_z)))
16773svuint16_t svhsubr_u16_z(svbool_t, svuint16_t, svuint16_t);
16774__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_index_u32)))
16775svuint32_t svldnt1_gather_u32base_index_u32(svbool_t, svuint32_t, int64_t);
16776__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_index_u64)))
16777svuint64_t svldnt1_gather_u64base_index_u64(svbool_t, svuint64_t, int64_t);
16778__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_index_f64)))
16779svfloat64_t svldnt1_gather_u64base_index_f64(svbool_t, svuint64_t, int64_t);
16780__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_index_f32)))
16781svfloat32_t svldnt1_gather_u32base_index_f32(svbool_t, svuint32_t, int64_t);
16782__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_index_s32)))
16783svint32_t svldnt1_gather_u32base_index_s32(svbool_t, svuint32_t, int64_t);
16784__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_index_s64)))
16785svint64_t svldnt1_gather_u64base_index_s64(svbool_t, svuint64_t, int64_t);
16786__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_offset_u32)))
16787svuint32_t svldnt1_gather_u32base_offset_u32(svbool_t, svuint32_t, int64_t);
16788__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_offset_u64)))
16789svuint64_t svldnt1_gather_u64base_offset_u64(svbool_t, svuint64_t, int64_t);
16790__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_offset_f64)))
16791svfloat64_t svldnt1_gather_u64base_offset_f64(svbool_t, svuint64_t, int64_t);
16792__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_offset_f32)))
16793svfloat32_t svldnt1_gather_u32base_offset_f32(svbool_t, svuint32_t, int64_t);
16794__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_offset_s32)))
16795svint32_t svldnt1_gather_u32base_offset_s32(svbool_t, svuint32_t, int64_t);
16796__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_offset_s64)))
16797svint64_t svldnt1_gather_u64base_offset_s64(svbool_t, svuint64_t, int64_t);
16798__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_u32)))
16799svuint32_t svldnt1_gather_u32base_u32(svbool_t, svuint32_t);
16800__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_u64)))
16801svuint64_t svldnt1_gather_u64base_u64(svbool_t, svuint64_t);
16802__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_f64)))
16803svfloat64_t svldnt1_gather_u64base_f64(svbool_t, svuint64_t);
16804__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_f32)))
16805svfloat32_t svldnt1_gather_u32base_f32(svbool_t, svuint32_t);
16806__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_s32)))
16807svint32_t svldnt1_gather_u32base_s32(svbool_t, svuint32_t);
16808__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_s64)))
16809svint64_t svldnt1_gather_u64base_s64(svbool_t, svuint64_t);
16810__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_s64index_u64)))
16811svuint64_t svldnt1_gather_s64index_u64(svbool_t, uint64_t const *, svint64_t);
16812__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_s64index_f64)))
16813svfloat64_t svldnt1_gather_s64index_f64(svbool_t, float64_t const *, svint64_t);
16814__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_s64index_s64)))
16815svint64_t svldnt1_gather_s64index_s64(svbool_t, int64_t const *, svint64_t);
16816__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64index_u64)))
16817svuint64_t svldnt1_gather_u64index_u64(svbool_t, uint64_t const *, svuint64_t);
16818__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64index_f64)))
16819svfloat64_t svldnt1_gather_u64index_f64(svbool_t, float64_t const *, svuint64_t);
16820__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64index_s64)))
16821svint64_t svldnt1_gather_u64index_s64(svbool_t, int64_t const *, svuint64_t);
16822__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32offset_u32)))
16823svuint32_t svldnt1_gather_u32offset_u32(svbool_t, uint32_t const *, svuint32_t);
16824__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32offset_f32)))
16825svfloat32_t svldnt1_gather_u32offset_f32(svbool_t, float32_t const *, svuint32_t);
16826__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32offset_s32)))
16827svint32_t svldnt1_gather_u32offset_s32(svbool_t, int32_t const *, svuint32_t);
16828__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_s64offset_u64)))
16829svuint64_t svldnt1_gather_s64offset_u64(svbool_t, uint64_t const *, svint64_t);
16830__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_s64offset_f64)))
16831svfloat64_t svldnt1_gather_s64offset_f64(svbool_t, float64_t const *, svint64_t);
16832__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_s64offset_s64)))
16833svint64_t svldnt1_gather_s64offset_s64(svbool_t, int64_t const *, svint64_t);
16834__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64offset_u64)))
16835svuint64_t svldnt1_gather_u64offset_u64(svbool_t, uint64_t const *, svuint64_t);
16836__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64offset_f64)))
16837svfloat64_t svldnt1_gather_u64offset_f64(svbool_t, float64_t const *, svuint64_t);
16838__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64offset_s64)))
16839svint64_t svldnt1_gather_u64offset_s64(svbool_t, int64_t const *, svuint64_t);
16840__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u32base_offset_u32)))
16841svuint32_t svldnt1sb_gather_u32base_offset_u32(svbool_t, svuint32_t, int64_t);
16842__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u64base_offset_u64)))
16843svuint64_t svldnt1sb_gather_u64base_offset_u64(svbool_t, svuint64_t, int64_t);
16844__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u32base_offset_s32)))
16845svint32_t svldnt1sb_gather_u32base_offset_s32(svbool_t, svuint32_t, int64_t);
16846__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u64base_offset_s64)))
16847svint64_t svldnt1sb_gather_u64base_offset_s64(svbool_t, svuint64_t, int64_t);
16848__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u32base_u32)))
16849svuint32_t svldnt1sb_gather_u32base_u32(svbool_t, svuint32_t);
16850__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u64base_u64)))
16851svuint64_t svldnt1sb_gather_u64base_u64(svbool_t, svuint64_t);
16852__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u32base_s32)))
16853svint32_t svldnt1sb_gather_u32base_s32(svbool_t, svuint32_t);
16854__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u64base_s64)))
16855svint64_t svldnt1sb_gather_u64base_s64(svbool_t, svuint64_t);
16856__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u32offset_u32)))
16857svuint32_t svldnt1sb_gather_u32offset_u32(svbool_t, int8_t const *, svuint32_t);
16858__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u32offset_s32)))
16859svint32_t svldnt1sb_gather_u32offset_s32(svbool_t, int8_t const *, svuint32_t);
16860__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_s64offset_u64)))
16861svuint64_t svldnt1sb_gather_s64offset_u64(svbool_t, int8_t const *, svint64_t);
16862__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_s64offset_s64)))
16863svint64_t svldnt1sb_gather_s64offset_s64(svbool_t, int8_t const *, svint64_t);
16864__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u64offset_u64)))
16865svuint64_t svldnt1sb_gather_u64offset_u64(svbool_t, int8_t const *, svuint64_t);
16866__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u64offset_s64)))
16867svint64_t svldnt1sb_gather_u64offset_s64(svbool_t, int8_t const *, svuint64_t);
16868__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32base_index_u32)))
16869svuint32_t svldnt1sh_gather_u32base_index_u32(svbool_t, svuint32_t, int64_t);
16870__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64base_index_u64)))
16871svuint64_t svldnt1sh_gather_u64base_index_u64(svbool_t, svuint64_t, int64_t);
16872__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32base_index_s32)))
16873svint32_t svldnt1sh_gather_u32base_index_s32(svbool_t, svuint32_t, int64_t);
16874__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64base_index_s64)))
16875svint64_t svldnt1sh_gather_u64base_index_s64(svbool_t, svuint64_t, int64_t);
16876__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32base_offset_u32)))
16877svuint32_t svldnt1sh_gather_u32base_offset_u32(svbool_t, svuint32_t, int64_t);
16878__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64base_offset_u64)))
16879svuint64_t svldnt1sh_gather_u64base_offset_u64(svbool_t, svuint64_t, int64_t);
16880__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32base_offset_s32)))
16881svint32_t svldnt1sh_gather_u32base_offset_s32(svbool_t, svuint32_t, int64_t);
16882__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64base_offset_s64)))
16883svint64_t svldnt1sh_gather_u64base_offset_s64(svbool_t, svuint64_t, int64_t);
16884__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32base_u32)))
16885svuint32_t svldnt1sh_gather_u32base_u32(svbool_t, svuint32_t);
16886__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64base_u64)))
16887svuint64_t svldnt1sh_gather_u64base_u64(svbool_t, svuint64_t);
16888__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32base_s32)))
16889svint32_t svldnt1sh_gather_u32base_s32(svbool_t, svuint32_t);
16890__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64base_s64)))
16891svint64_t svldnt1sh_gather_u64base_s64(svbool_t, svuint64_t);
16892__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_s64index_u64)))
16893svuint64_t svldnt1sh_gather_s64index_u64(svbool_t, int16_t const *, svint64_t);
16894__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_s64index_s64)))
16895svint64_t svldnt1sh_gather_s64index_s64(svbool_t, int16_t const *, svint64_t);
16896__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64index_u64)))
16897svuint64_t svldnt1sh_gather_u64index_u64(svbool_t, int16_t const *, svuint64_t);
16898__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64index_s64)))
16899svint64_t svldnt1sh_gather_u64index_s64(svbool_t, int16_t const *, svuint64_t);
16900__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32offset_u32)))
16901svuint32_t svldnt1sh_gather_u32offset_u32(svbool_t, int16_t const *, svuint32_t);
16902__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32offset_s32)))
16903svint32_t svldnt1sh_gather_u32offset_s32(svbool_t, int16_t const *, svuint32_t);
16904__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_s64offset_u64)))
16905svuint64_t svldnt1sh_gather_s64offset_u64(svbool_t, int16_t const *, svint64_t);
16906__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_s64offset_s64)))
16907svint64_t svldnt1sh_gather_s64offset_s64(svbool_t, int16_t const *, svint64_t);
16908__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64offset_u64)))
16909svuint64_t svldnt1sh_gather_u64offset_u64(svbool_t, int16_t const *, svuint64_t);
16910__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64offset_s64)))
16911svint64_t svldnt1sh_gather_u64offset_s64(svbool_t, int16_t const *, svuint64_t);
16912__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64base_index_u64)))
16913svuint64_t svldnt1sw_gather_u64base_index_u64(svbool_t, svuint64_t, int64_t);
16914__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64base_index_s64)))
16915svint64_t svldnt1sw_gather_u64base_index_s64(svbool_t, svuint64_t, int64_t);
16916__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64base_offset_u64)))
16917svuint64_t svldnt1sw_gather_u64base_offset_u64(svbool_t, svuint64_t, int64_t);
16918__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64base_offset_s64)))
16919svint64_t svldnt1sw_gather_u64base_offset_s64(svbool_t, svuint64_t, int64_t);
16920__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64base_u64)))
16921svuint64_t svldnt1sw_gather_u64base_u64(svbool_t, svuint64_t);
16922__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64base_s64)))
16923svint64_t svldnt1sw_gather_u64base_s64(svbool_t, svuint64_t);
16924__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_s64index_u64)))
16925svuint64_t svldnt1sw_gather_s64index_u64(svbool_t, int32_t const *, svint64_t);
16926__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_s64index_s64)))
16927svint64_t svldnt1sw_gather_s64index_s64(svbool_t, int32_t const *, svint64_t);
16928__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64index_u64)))
16929svuint64_t svldnt1sw_gather_u64index_u64(svbool_t, int32_t const *, svuint64_t);
16930__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64index_s64)))
16931svint64_t svldnt1sw_gather_u64index_s64(svbool_t, int32_t const *, svuint64_t);
16932__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_s64offset_u64)))
16933svuint64_t svldnt1sw_gather_s64offset_u64(svbool_t, int32_t const *, svint64_t);
16934__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_s64offset_s64)))
16935svint64_t svldnt1sw_gather_s64offset_s64(svbool_t, int32_t const *, svint64_t);
16936__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64offset_u64)))
16937svuint64_t svldnt1sw_gather_u64offset_u64(svbool_t, int32_t const *, svuint64_t);
16938__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64offset_s64)))
16939svint64_t svldnt1sw_gather_u64offset_s64(svbool_t, int32_t const *, svuint64_t);
16940__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u32base_offset_u32)))
16941svuint32_t svldnt1ub_gather_u32base_offset_u32(svbool_t, svuint32_t, int64_t);
16942__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u64base_offset_u64)))
16943svuint64_t svldnt1ub_gather_u64base_offset_u64(svbool_t, svuint64_t, int64_t);
16944__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u32base_offset_s32)))
16945svint32_t svldnt1ub_gather_u32base_offset_s32(svbool_t, svuint32_t, int64_t);
16946__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u64base_offset_s64)))
16947svint64_t svldnt1ub_gather_u64base_offset_s64(svbool_t, svuint64_t, int64_t);
16948__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u32base_u32)))
16949svuint32_t svldnt1ub_gather_u32base_u32(svbool_t, svuint32_t);
16950__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u64base_u64)))
16951svuint64_t svldnt1ub_gather_u64base_u64(svbool_t, svuint64_t);
16952__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u32base_s32)))
16953svint32_t svldnt1ub_gather_u32base_s32(svbool_t, svuint32_t);
16954__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u64base_s64)))
16955svint64_t svldnt1ub_gather_u64base_s64(svbool_t, svuint64_t);
16956__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u32offset_u32)))
16957svuint32_t svldnt1ub_gather_u32offset_u32(svbool_t, uint8_t const *, svuint32_t);
16958__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u32offset_s32)))
16959svint32_t svldnt1ub_gather_u32offset_s32(svbool_t, uint8_t const *, svuint32_t);
16960__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_s64offset_u64)))
16961svuint64_t svldnt1ub_gather_s64offset_u64(svbool_t, uint8_t const *, svint64_t);
16962__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_s64offset_s64)))
16963svint64_t svldnt1ub_gather_s64offset_s64(svbool_t, uint8_t const *, svint64_t);
16964__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u64offset_u64)))
16965svuint64_t svldnt1ub_gather_u64offset_u64(svbool_t, uint8_t const *, svuint64_t);
16966__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u64offset_s64)))
16967svint64_t svldnt1ub_gather_u64offset_s64(svbool_t, uint8_t const *, svuint64_t);
16968__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32base_index_u32)))
16969svuint32_t svldnt1uh_gather_u32base_index_u32(svbool_t, svuint32_t, int64_t);
16970__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64base_index_u64)))
16971svuint64_t svldnt1uh_gather_u64base_index_u64(svbool_t, svuint64_t, int64_t);
16972__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32base_index_s32)))
16973svint32_t svldnt1uh_gather_u32base_index_s32(svbool_t, svuint32_t, int64_t);
16974__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64base_index_s64)))
16975svint64_t svldnt1uh_gather_u64base_index_s64(svbool_t, svuint64_t, int64_t);
16976__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32base_offset_u32)))
16977svuint32_t svldnt1uh_gather_u32base_offset_u32(svbool_t, svuint32_t, int64_t);
16978__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64base_offset_u64)))
16979svuint64_t svldnt1uh_gather_u64base_offset_u64(svbool_t, svuint64_t, int64_t);
16980__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32base_offset_s32)))
16981svint32_t svldnt1uh_gather_u32base_offset_s32(svbool_t, svuint32_t, int64_t);
16982__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64base_offset_s64)))
16983svint64_t svldnt1uh_gather_u64base_offset_s64(svbool_t, svuint64_t, int64_t);
16984__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32base_u32)))
16985svuint32_t svldnt1uh_gather_u32base_u32(svbool_t, svuint32_t);
16986__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64base_u64)))
16987svuint64_t svldnt1uh_gather_u64base_u64(svbool_t, svuint64_t);
16988__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32base_s32)))
16989svint32_t svldnt1uh_gather_u32base_s32(svbool_t, svuint32_t);
16990__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64base_s64)))
16991svint64_t svldnt1uh_gather_u64base_s64(svbool_t, svuint64_t);
16992__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_s64index_u64)))
16993svuint64_t svldnt1uh_gather_s64index_u64(svbool_t, uint16_t const *, svint64_t);
16994__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_s64index_s64)))
16995svint64_t svldnt1uh_gather_s64index_s64(svbool_t, uint16_t const *, svint64_t);
16996__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64index_u64)))
16997svuint64_t svldnt1uh_gather_u64index_u64(svbool_t, uint16_t const *, svuint64_t);
16998__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64index_s64)))
16999svint64_t svldnt1uh_gather_u64index_s64(svbool_t, uint16_t const *, svuint64_t);
17000__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32offset_u32)))
17001svuint32_t svldnt1uh_gather_u32offset_u32(svbool_t, uint16_t const *, svuint32_t);
17002__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32offset_s32)))
17003svint32_t svldnt1uh_gather_u32offset_s32(svbool_t, uint16_t const *, svuint32_t);
17004__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_s64offset_u64)))
17005svuint64_t svldnt1uh_gather_s64offset_u64(svbool_t, uint16_t const *, svint64_t);
17006__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_s64offset_s64)))
17007svint64_t svldnt1uh_gather_s64offset_s64(svbool_t, uint16_t const *, svint64_t);
17008__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64offset_u64)))
17009svuint64_t svldnt1uh_gather_u64offset_u64(svbool_t, uint16_t const *, svuint64_t);
17010__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64offset_s64)))
17011svint64_t svldnt1uh_gather_u64offset_s64(svbool_t, uint16_t const *, svuint64_t);
17012__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64base_index_u64)))
17013svuint64_t svldnt1uw_gather_u64base_index_u64(svbool_t, svuint64_t, int64_t);
17014__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64base_index_s64)))
17015svint64_t svldnt1uw_gather_u64base_index_s64(svbool_t, svuint64_t, int64_t);
17016__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64base_offset_u64)))
17017svuint64_t svldnt1uw_gather_u64base_offset_u64(svbool_t, svuint64_t, int64_t);
17018__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64base_offset_s64)))
17019svint64_t svldnt1uw_gather_u64base_offset_s64(svbool_t, svuint64_t, int64_t);
17020__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64base_u64)))
17021svuint64_t svldnt1uw_gather_u64base_u64(svbool_t, svuint64_t);
17022__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64base_s64)))
17023svint64_t svldnt1uw_gather_u64base_s64(svbool_t, svuint64_t);
17024__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_s64index_u64)))
17025svuint64_t svldnt1uw_gather_s64index_u64(svbool_t, uint32_t const *, svint64_t);
17026__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_s64index_s64)))
17027svint64_t svldnt1uw_gather_s64index_s64(svbool_t, uint32_t const *, svint64_t);
17028__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64index_u64)))
17029svuint64_t svldnt1uw_gather_u64index_u64(svbool_t, uint32_t const *, svuint64_t);
17030__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64index_s64)))
17031svint64_t svldnt1uw_gather_u64index_s64(svbool_t, uint32_t const *, svuint64_t);
17032__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_s64offset_u64)))
17033svuint64_t svldnt1uw_gather_s64offset_u64(svbool_t, uint32_t const *, svint64_t);
17034__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_s64offset_s64)))
17035svint64_t svldnt1uw_gather_s64offset_s64(svbool_t, uint32_t const *, svint64_t);
17036__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64offset_u64)))
17037svuint64_t svldnt1uw_gather_u64offset_u64(svbool_t, uint32_t const *, svuint64_t);
17038__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64offset_s64)))
17039svint64_t svldnt1uw_gather_u64offset_s64(svbool_t, uint32_t const *, svuint64_t);
17040__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f64_m)))
17041svint64_t svlogb_f64_m(svint64_t, svbool_t, svfloat64_t);
17042__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f32_m)))
17043svint32_t svlogb_f32_m(svint32_t, svbool_t, svfloat32_t);
17044__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f16_m)))
17045svint16_t svlogb_f16_m(svint16_t, svbool_t, svfloat16_t);
17046__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f64_x)))
17047svint64_t svlogb_f64_x(svbool_t, svfloat64_t);
17048__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f32_x)))
17049svint32_t svlogb_f32_x(svbool_t, svfloat32_t);
17050__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f16_x)))
17051svint16_t svlogb_f16_x(svbool_t, svfloat16_t);
17052__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f64_z)))
17053svint64_t svlogb_f64_z(svbool_t, svfloat64_t);
17054__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f32_z)))
17055svint32_t svlogb_f32_z(svbool_t, svfloat32_t);
17056__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f16_z)))
17057svint16_t svlogb_f16_z(svbool_t, svfloat16_t);
17058__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmatch_u8)))
17059svbool_t svmatch_u8(svbool_t, svuint8_t, svuint8_t);
17060__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmatch_u16)))
17061svbool_t svmatch_u16(svbool_t, svuint16_t, svuint16_t);
17062__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmatch_s8)))
17063svbool_t svmatch_s8(svbool_t, svint8_t, svint8_t);
17064__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmatch_s16)))
17065svbool_t svmatch_s16(svbool_t, svint16_t, svint16_t);
17066__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxnmp_f64_m)))
17067svfloat64_t svmaxnmp_f64_m(svbool_t, svfloat64_t, svfloat64_t);
17068__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxnmp_f32_m)))
17069svfloat32_t svmaxnmp_f32_m(svbool_t, svfloat32_t, svfloat32_t);
17070__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxnmp_f16_m)))
17071svfloat16_t svmaxnmp_f16_m(svbool_t, svfloat16_t, svfloat16_t);
17072__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxnmp_f64_x)))
17073svfloat64_t svmaxnmp_f64_x(svbool_t, svfloat64_t, svfloat64_t);
17074__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxnmp_f32_x)))
17075svfloat32_t svmaxnmp_f32_x(svbool_t, svfloat32_t, svfloat32_t);
17076__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxnmp_f16_x)))
17077svfloat16_t svmaxnmp_f16_x(svbool_t, svfloat16_t, svfloat16_t);
17078__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_f64_m)))
17079svfloat64_t svmaxp_f64_m(svbool_t, svfloat64_t, svfloat64_t);
17080__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_f32_m)))
17081svfloat32_t svmaxp_f32_m(svbool_t, svfloat32_t, svfloat32_t);
17082__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_f16_m)))
17083svfloat16_t svmaxp_f16_m(svbool_t, svfloat16_t, svfloat16_t);
17084__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_f64_x)))
17085svfloat64_t svmaxp_f64_x(svbool_t, svfloat64_t, svfloat64_t);
17086__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_f32_x)))
17087svfloat32_t svmaxp_f32_x(svbool_t, svfloat32_t, svfloat32_t);
17088__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_f16_x)))
17089svfloat16_t svmaxp_f16_x(svbool_t, svfloat16_t, svfloat16_t);
17090__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s8_m)))
17091svint8_t svmaxp_s8_m(svbool_t, svint8_t, svint8_t);
17092__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s32_m)))
17093svint32_t svmaxp_s32_m(svbool_t, svint32_t, svint32_t);
17094__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s64_m)))
17095svint64_t svmaxp_s64_m(svbool_t, svint64_t, svint64_t);
17096__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s16_m)))
17097svint16_t svmaxp_s16_m(svbool_t, svint16_t, svint16_t);
17098__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s8_x)))
17099svint8_t svmaxp_s8_x(svbool_t, svint8_t, svint8_t);
17100__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s32_x)))
17101svint32_t svmaxp_s32_x(svbool_t, svint32_t, svint32_t);
17102__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s64_x)))
17103svint64_t svmaxp_s64_x(svbool_t, svint64_t, svint64_t);
17104__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s16_x)))
17105svint16_t svmaxp_s16_x(svbool_t, svint16_t, svint16_t);
17106__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u8_m)))
17107svuint8_t svmaxp_u8_m(svbool_t, svuint8_t, svuint8_t);
17108__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u32_m)))
17109svuint32_t svmaxp_u32_m(svbool_t, svuint32_t, svuint32_t);
17110__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u64_m)))
17111svuint64_t svmaxp_u64_m(svbool_t, svuint64_t, svuint64_t);
17112__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u16_m)))
17113svuint16_t svmaxp_u16_m(svbool_t, svuint16_t, svuint16_t);
17114__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u8_x)))
17115svuint8_t svmaxp_u8_x(svbool_t, svuint8_t, svuint8_t);
17116__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u32_x)))
17117svuint32_t svmaxp_u32_x(svbool_t, svuint32_t, svuint32_t);
17118__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u64_x)))
17119svuint64_t svmaxp_u64_x(svbool_t, svuint64_t, svuint64_t);
17120__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u16_x)))
17121svuint16_t svmaxp_u16_x(svbool_t, svuint16_t, svuint16_t);
17122__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminnmp_f64_m)))
17123svfloat64_t svminnmp_f64_m(svbool_t, svfloat64_t, svfloat64_t);
17124__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminnmp_f32_m)))
17125svfloat32_t svminnmp_f32_m(svbool_t, svfloat32_t, svfloat32_t);
17126__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminnmp_f16_m)))
17127svfloat16_t svminnmp_f16_m(svbool_t, svfloat16_t, svfloat16_t);
17128__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminnmp_f64_x)))
17129svfloat64_t svminnmp_f64_x(svbool_t, svfloat64_t, svfloat64_t);
17130__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminnmp_f32_x)))
17131svfloat32_t svminnmp_f32_x(svbool_t, svfloat32_t, svfloat32_t);
17132__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminnmp_f16_x)))
17133svfloat16_t svminnmp_f16_x(svbool_t, svfloat16_t, svfloat16_t);
17134__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_f64_m)))
17135svfloat64_t svminp_f64_m(svbool_t, svfloat64_t, svfloat64_t);
17136__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_f32_m)))
17137svfloat32_t svminp_f32_m(svbool_t, svfloat32_t, svfloat32_t);
17138__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_f16_m)))
17139svfloat16_t svminp_f16_m(svbool_t, svfloat16_t, svfloat16_t);
17140__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_f64_x)))
17141svfloat64_t svminp_f64_x(svbool_t, svfloat64_t, svfloat64_t);
17142__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_f32_x)))
17143svfloat32_t svminp_f32_x(svbool_t, svfloat32_t, svfloat32_t);
17144__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_f16_x)))
17145svfloat16_t svminp_f16_x(svbool_t, svfloat16_t, svfloat16_t);
17146__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s8_m)))
17147svint8_t svminp_s8_m(svbool_t, svint8_t, svint8_t);
17148__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s32_m)))
17149svint32_t svminp_s32_m(svbool_t, svint32_t, svint32_t);
17150__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s64_m)))
17151svint64_t svminp_s64_m(svbool_t, svint64_t, svint64_t);
17152__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s16_m)))
17153svint16_t svminp_s16_m(svbool_t, svint16_t, svint16_t);
17154__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s8_x)))
17155svint8_t svminp_s8_x(svbool_t, svint8_t, svint8_t);
17156__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s32_x)))
17157svint32_t svminp_s32_x(svbool_t, svint32_t, svint32_t);
17158__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s64_x)))
17159svint64_t svminp_s64_x(svbool_t, svint64_t, svint64_t);
17160__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s16_x)))
17161svint16_t svminp_s16_x(svbool_t, svint16_t, svint16_t);
17162__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u8_m)))
17163svuint8_t svminp_u8_m(svbool_t, svuint8_t, svuint8_t);
17164__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u32_m)))
17165svuint32_t svminp_u32_m(svbool_t, svuint32_t, svuint32_t);
17166__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u64_m)))
17167svuint64_t svminp_u64_m(svbool_t, svuint64_t, svuint64_t);
17168__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u16_m)))
17169svuint16_t svminp_u16_m(svbool_t, svuint16_t, svuint16_t);
17170__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u8_x)))
17171svuint8_t svminp_u8_x(svbool_t, svuint8_t, svuint8_t);
17172__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u32_x)))
17173svuint32_t svminp_u32_x(svbool_t, svuint32_t, svuint32_t);
17174__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u64_x)))
17175svuint64_t svminp_u64_x(svbool_t, svuint64_t, svuint64_t);
17176__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u16_x)))
17177svuint16_t svminp_u16_x(svbool_t, svuint16_t, svuint16_t);
17178__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmla_lane_u32)))
17179svuint32_t svmla_lane_u32(svuint32_t, svuint32_t, svuint32_t, uint64_t);
17180__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmla_lane_u64)))
17181svuint64_t svmla_lane_u64(svuint64_t, svuint64_t, svuint64_t, uint64_t);
17182__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmla_lane_u16)))
17183svuint16_t svmla_lane_u16(svuint16_t, svuint16_t, svuint16_t, uint64_t);
17184__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmla_lane_s32)))
17185svint32_t svmla_lane_s32(svint32_t, svint32_t, svint32_t, uint64_t);
17186__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmla_lane_s64)))
17187svint64_t svmla_lane_s64(svint64_t, svint64_t, svint64_t, uint64_t);
17188__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmla_lane_s16)))
17189svint16_t svmla_lane_s16(svint16_t, svint16_t, svint16_t, uint64_t);
17190__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_n_f32)))
17191svfloat32_t svmlalb_n_f32(svfloat32_t, svfloat16_t, float16_t);
17192__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_n_s32)))
17193svint32_t svmlalb_n_s32(svint32_t, svint16_t, int16_t);
17194__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_n_s64)))
17195svint64_t svmlalb_n_s64(svint64_t, svint32_t, int32_t);
17196__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_n_s16)))
17197svint16_t svmlalb_n_s16(svint16_t, svint8_t, int8_t);
17198__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_n_u32)))
17199svuint32_t svmlalb_n_u32(svuint32_t, svuint16_t, uint16_t);
17200__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_n_u64)))
17201svuint64_t svmlalb_n_u64(svuint64_t, svuint32_t, uint32_t);
17202__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_n_u16)))
17203svuint16_t svmlalb_n_u16(svuint16_t, svuint8_t, uint8_t);
17204__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_f32)))
17205svfloat32_t svmlalb_f32(svfloat32_t, svfloat16_t, svfloat16_t);
17206__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_s32)))
17207svint32_t svmlalb_s32(svint32_t, svint16_t, svint16_t);
17208__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_s64)))
17209svint64_t svmlalb_s64(svint64_t, svint32_t, svint32_t);
17210__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_s16)))
17211svint16_t svmlalb_s16(svint16_t, svint8_t, svint8_t);
17212__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_u32)))
17213svuint32_t svmlalb_u32(svuint32_t, svuint16_t, svuint16_t);
17214__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_u64)))
17215svuint64_t svmlalb_u64(svuint64_t, svuint32_t, svuint32_t);
17216__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_u16)))
17217svuint16_t svmlalb_u16(svuint16_t, svuint8_t, svuint8_t);
17218__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_lane_f32)))
17219svfloat32_t svmlalb_lane_f32(svfloat32_t, svfloat16_t, svfloat16_t, uint64_t);
17220__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_lane_s32)))
17221svint32_t svmlalb_lane_s32(svint32_t, svint16_t, svint16_t, uint64_t);
17222__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_lane_s64)))
17223svint64_t svmlalb_lane_s64(svint64_t, svint32_t, svint32_t, uint64_t);
17224__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_lane_u32)))
17225svuint32_t svmlalb_lane_u32(svuint32_t, svuint16_t, svuint16_t, uint64_t);
17226__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_lane_u64)))
17227svuint64_t svmlalb_lane_u64(svuint64_t, svuint32_t, svuint32_t, uint64_t);
17228__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_n_f32)))
17229svfloat32_t svmlalt_n_f32(svfloat32_t, svfloat16_t, float16_t);
17230__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_n_s32)))
17231svint32_t svmlalt_n_s32(svint32_t, svint16_t, int16_t);
17232__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_n_s64)))
17233svint64_t svmlalt_n_s64(svint64_t, svint32_t, int32_t);
17234__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_n_s16)))
17235svint16_t svmlalt_n_s16(svint16_t, svint8_t, int8_t);
17236__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_n_u32)))
17237svuint32_t svmlalt_n_u32(svuint32_t, svuint16_t, uint16_t);
17238__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_n_u64)))
17239svuint64_t svmlalt_n_u64(svuint64_t, svuint32_t, uint32_t);
17240__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_n_u16)))
17241svuint16_t svmlalt_n_u16(svuint16_t, svuint8_t, uint8_t);
17242__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_f32)))
17243svfloat32_t svmlalt_f32(svfloat32_t, svfloat16_t, svfloat16_t);
17244__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_s32)))
17245svint32_t svmlalt_s32(svint32_t, svint16_t, svint16_t);
17246__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_s64)))
17247svint64_t svmlalt_s64(svint64_t, svint32_t, svint32_t);
17248__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_s16)))
17249svint16_t svmlalt_s16(svint16_t, svint8_t, svint8_t);
17250__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_u32)))
17251svuint32_t svmlalt_u32(svuint32_t, svuint16_t, svuint16_t);
17252__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_u64)))
17253svuint64_t svmlalt_u64(svuint64_t, svuint32_t, svuint32_t);
17254__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_u16)))
17255svuint16_t svmlalt_u16(svuint16_t, svuint8_t, svuint8_t);
17256__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_lane_f32)))
17257svfloat32_t svmlalt_lane_f32(svfloat32_t, svfloat16_t, svfloat16_t, uint64_t);
17258__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_lane_s32)))
17259svint32_t svmlalt_lane_s32(svint32_t, svint16_t, svint16_t, uint64_t);
17260__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_lane_s64)))
17261svint64_t svmlalt_lane_s64(svint64_t, svint32_t, svint32_t, uint64_t);
17262__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_lane_u32)))
17263svuint32_t svmlalt_lane_u32(svuint32_t, svuint16_t, svuint16_t, uint64_t);
17264__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_lane_u64)))
17265svuint64_t svmlalt_lane_u64(svuint64_t, svuint32_t, svuint32_t, uint64_t);
17266__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmls_lane_u32)))
17267svuint32_t svmls_lane_u32(svuint32_t, svuint32_t, svuint32_t, uint64_t);
17268__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmls_lane_u64)))
17269svuint64_t svmls_lane_u64(svuint64_t, svuint64_t, svuint64_t, uint64_t);
17270__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmls_lane_u16)))
17271svuint16_t svmls_lane_u16(svuint16_t, svuint16_t, svuint16_t, uint64_t);
17272__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmls_lane_s32)))
17273svint32_t svmls_lane_s32(svint32_t, svint32_t, svint32_t, uint64_t);
17274__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmls_lane_s64)))
17275svint64_t svmls_lane_s64(svint64_t, svint64_t, svint64_t, uint64_t);
17276__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmls_lane_s16)))
17277svint16_t svmls_lane_s16(svint16_t, svint16_t, svint16_t, uint64_t);
17278__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_n_f32)))
17279svfloat32_t svmlslb_n_f32(svfloat32_t, svfloat16_t, float16_t);
17280__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_n_s32)))
17281svint32_t svmlslb_n_s32(svint32_t, svint16_t, int16_t);
17282__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_n_s64)))
17283svint64_t svmlslb_n_s64(svint64_t, svint32_t, int32_t);
17284__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_n_s16)))
17285svint16_t svmlslb_n_s16(svint16_t, svint8_t, int8_t);
17286__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_n_u32)))
17287svuint32_t svmlslb_n_u32(svuint32_t, svuint16_t, uint16_t);
17288__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_n_u64)))
17289svuint64_t svmlslb_n_u64(svuint64_t, svuint32_t, uint32_t);
17290__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_n_u16)))
17291svuint16_t svmlslb_n_u16(svuint16_t, svuint8_t, uint8_t);
17292__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_f32)))
17293svfloat32_t svmlslb_f32(svfloat32_t, svfloat16_t, svfloat16_t);
17294__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_s32)))
17295svint32_t svmlslb_s32(svint32_t, svint16_t, svint16_t);
17296__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_s64)))
17297svint64_t svmlslb_s64(svint64_t, svint32_t, svint32_t);
17298__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_s16)))
17299svint16_t svmlslb_s16(svint16_t, svint8_t, svint8_t);
17300__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_u32)))
17301svuint32_t svmlslb_u32(svuint32_t, svuint16_t, svuint16_t);
17302__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_u64)))
17303svuint64_t svmlslb_u64(svuint64_t, svuint32_t, svuint32_t);
17304__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_u16)))
17305svuint16_t svmlslb_u16(svuint16_t, svuint8_t, svuint8_t);
17306__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_lane_f32)))
17307svfloat32_t svmlslb_lane_f32(svfloat32_t, svfloat16_t, svfloat16_t, uint64_t);
17308__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_lane_s32)))
17309svint32_t svmlslb_lane_s32(svint32_t, svint16_t, svint16_t, uint64_t);
17310__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_lane_s64)))
17311svint64_t svmlslb_lane_s64(svint64_t, svint32_t, svint32_t, uint64_t);
17312__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_lane_u32)))
17313svuint32_t svmlslb_lane_u32(svuint32_t, svuint16_t, svuint16_t, uint64_t);
17314__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_lane_u64)))
17315svuint64_t svmlslb_lane_u64(svuint64_t, svuint32_t, svuint32_t, uint64_t);
17316__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_n_f32)))
17317svfloat32_t svmlslt_n_f32(svfloat32_t, svfloat16_t, float16_t);
17318__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_n_s32)))
17319svint32_t svmlslt_n_s32(svint32_t, svint16_t, int16_t);
17320__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_n_s64)))
17321svint64_t svmlslt_n_s64(svint64_t, svint32_t, int32_t);
17322__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_n_s16)))
17323svint16_t svmlslt_n_s16(svint16_t, svint8_t, int8_t);
17324__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_n_u32)))
17325svuint32_t svmlslt_n_u32(svuint32_t, svuint16_t, uint16_t);
17326__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_n_u64)))
17327svuint64_t svmlslt_n_u64(svuint64_t, svuint32_t, uint32_t);
17328__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_n_u16)))
17329svuint16_t svmlslt_n_u16(svuint16_t, svuint8_t, uint8_t);
17330__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_f32)))
17331svfloat32_t svmlslt_f32(svfloat32_t, svfloat16_t, svfloat16_t);
17332__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_s32)))
17333svint32_t svmlslt_s32(svint32_t, svint16_t, svint16_t);
17334__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_s64)))
17335svint64_t svmlslt_s64(svint64_t, svint32_t, svint32_t);
17336__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_s16)))
17337svint16_t svmlslt_s16(svint16_t, svint8_t, svint8_t);
17338__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_u32)))
17339svuint32_t svmlslt_u32(svuint32_t, svuint16_t, svuint16_t);
17340__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_u64)))
17341svuint64_t svmlslt_u64(svuint64_t, svuint32_t, svuint32_t);
17342__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_u16)))
17343svuint16_t svmlslt_u16(svuint16_t, svuint8_t, svuint8_t);
17344__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_lane_f32)))
17345svfloat32_t svmlslt_lane_f32(svfloat32_t, svfloat16_t, svfloat16_t, uint64_t);
17346__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_lane_s32)))
17347svint32_t svmlslt_lane_s32(svint32_t, svint16_t, svint16_t, uint64_t);
17348__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_lane_s64)))
17349svint64_t svmlslt_lane_s64(svint64_t, svint32_t, svint32_t, uint64_t);
17350__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_lane_u32)))
17351svuint32_t svmlslt_lane_u32(svuint32_t, svuint16_t, svuint16_t, uint64_t);
17352__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_lane_u64)))
17353svuint64_t svmlslt_lane_u64(svuint64_t, svuint32_t, svuint32_t, uint64_t);
17354__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlb_s32)))
17355svint32_t svmovlb_s32(svint16_t);
17356__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlb_s64)))
17357svint64_t svmovlb_s64(svint32_t);
17358__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlb_s16)))
17359svint16_t svmovlb_s16(svint8_t);
17360__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlb_u32)))
17361svuint32_t svmovlb_u32(svuint16_t);
17362__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlb_u64)))
17363svuint64_t svmovlb_u64(svuint32_t);
17364__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlb_u16)))
17365svuint16_t svmovlb_u16(svuint8_t);
17366__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlt_s32)))
17367svint32_t svmovlt_s32(svint16_t);
17368__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlt_s64)))
17369svint64_t svmovlt_s64(svint32_t);
17370__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlt_s16)))
17371svint16_t svmovlt_s16(svint8_t);
17372__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlt_u32)))
17373svuint32_t svmovlt_u32(svuint16_t);
17374__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlt_u64)))
17375svuint64_t svmovlt_u64(svuint32_t);
17376__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlt_u16)))
17377svuint16_t svmovlt_u16(svuint8_t);
17378__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmul_lane_u32)))
17379svuint32_t svmul_lane_u32(svuint32_t, svuint32_t, uint64_t);
17380__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmul_lane_u64)))
17381svuint64_t svmul_lane_u64(svuint64_t, svuint64_t, uint64_t);
17382__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmul_lane_u16)))
17383svuint16_t svmul_lane_u16(svuint16_t, svuint16_t, uint64_t);
17384__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmul_lane_s32)))
17385svint32_t svmul_lane_s32(svint32_t, svint32_t, uint64_t);
17386__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmul_lane_s64)))
17387svint64_t svmul_lane_s64(svint64_t, svint64_t, uint64_t);
17388__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmul_lane_s16)))
17389svint16_t svmul_lane_s16(svint16_t, svint16_t, uint64_t);
17390__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_n_s32)))
17391svint32_t svmullb_n_s32(svint16_t, int16_t);
17392__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_n_s64)))
17393svint64_t svmullb_n_s64(svint32_t, int32_t);
17394__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_n_s16)))
17395svint16_t svmullb_n_s16(svint8_t, int8_t);
17396__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_n_u32)))
17397svuint32_t svmullb_n_u32(svuint16_t, uint16_t);
17398__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_n_u64)))
17399svuint64_t svmullb_n_u64(svuint32_t, uint32_t);
17400__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_n_u16)))
17401svuint16_t svmullb_n_u16(svuint8_t, uint8_t);
17402__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_s32)))
17403svint32_t svmullb_s32(svint16_t, svint16_t);
17404__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_s64)))
17405svint64_t svmullb_s64(svint32_t, svint32_t);
17406__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_s16)))
17407svint16_t svmullb_s16(svint8_t, svint8_t);
17408__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_u32)))
17409svuint32_t svmullb_u32(svuint16_t, svuint16_t);
17410__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_u64)))
17411svuint64_t svmullb_u64(svuint32_t, svuint32_t);
17412__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_u16)))
17413svuint16_t svmullb_u16(svuint8_t, svuint8_t);
17414__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_lane_s32)))
17415svint32_t svmullb_lane_s32(svint16_t, svint16_t, uint64_t);
17416__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_lane_s64)))
17417svint64_t svmullb_lane_s64(svint32_t, svint32_t, uint64_t);
17418__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_lane_u32)))
17419svuint32_t svmullb_lane_u32(svuint16_t, svuint16_t, uint64_t);
17420__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_lane_u64)))
17421svuint64_t svmullb_lane_u64(svuint32_t, svuint32_t, uint64_t);
17422__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_n_s32)))
17423svint32_t svmullt_n_s32(svint16_t, int16_t);
17424__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_n_s64)))
17425svint64_t svmullt_n_s64(svint32_t, int32_t);
17426__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_n_s16)))
17427svint16_t svmullt_n_s16(svint8_t, int8_t);
17428__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_n_u32)))
17429svuint32_t svmullt_n_u32(svuint16_t, uint16_t);
17430__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_n_u64)))
17431svuint64_t svmullt_n_u64(svuint32_t, uint32_t);
17432__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_n_u16)))
17433svuint16_t svmullt_n_u16(svuint8_t, uint8_t);
17434__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_s32)))
17435svint32_t svmullt_s32(svint16_t, svint16_t);
17436__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_s64)))
17437svint64_t svmullt_s64(svint32_t, svint32_t);
17438__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_s16)))
17439svint16_t svmullt_s16(svint8_t, svint8_t);
17440__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_u32)))
17441svuint32_t svmullt_u32(svuint16_t, svuint16_t);
17442__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_u64)))
17443svuint64_t svmullt_u64(svuint32_t, svuint32_t);
17444__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_u16)))
17445svuint16_t svmullt_u16(svuint8_t, svuint8_t);
17446__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_lane_s32)))
17447svint32_t svmullt_lane_s32(svint16_t, svint16_t, uint64_t);
17448__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_lane_s64)))
17449svint64_t svmullt_lane_s64(svint32_t, svint32_t, uint64_t);
17450__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_lane_u32)))
17451svuint32_t svmullt_lane_u32(svuint16_t, svuint16_t, uint64_t);
17452__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_lane_u64)))
17453svuint64_t svmullt_lane_u64(svuint32_t, svuint32_t, uint64_t);
17454__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_u8)))
17455svuint8_t svnbsl_n_u8(svuint8_t, svuint8_t, uint8_t);
17456__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_u32)))
17457svuint32_t svnbsl_n_u32(svuint32_t, svuint32_t, uint32_t);
17458__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_u64)))
17459svuint64_t svnbsl_n_u64(svuint64_t, svuint64_t, uint64_t);
17460__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_u16)))
17461svuint16_t svnbsl_n_u16(svuint16_t, svuint16_t, uint16_t);
17462__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_s8)))
17463svint8_t svnbsl_n_s8(svint8_t, svint8_t, int8_t);
17464__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_s32)))
17465svint32_t svnbsl_n_s32(svint32_t, svint32_t, int32_t);
17466__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_s64)))
17467svint64_t svnbsl_n_s64(svint64_t, svint64_t, int64_t);
17468__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_s16)))
17469svint16_t svnbsl_n_s16(svint16_t, svint16_t, int16_t);
17470__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_u8)))
17471svuint8_t svnbsl_u8(svuint8_t, svuint8_t, svuint8_t);
17472__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_u32)))
17473svuint32_t svnbsl_u32(svuint32_t, svuint32_t, svuint32_t);
17474__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_u64)))
17475svuint64_t svnbsl_u64(svuint64_t, svuint64_t, svuint64_t);
17476__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_u16)))
17477svuint16_t svnbsl_u16(svuint16_t, svuint16_t, svuint16_t);
17478__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_s8)))
17479svint8_t svnbsl_s8(svint8_t, svint8_t, svint8_t);
17480__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_s32)))
17481svint32_t svnbsl_s32(svint32_t, svint32_t, svint32_t);
17482__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_s64)))
17483svint64_t svnbsl_s64(svint64_t, svint64_t, svint64_t);
17484__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_s16)))
17485svint16_t svnbsl_s16(svint16_t, svint16_t, svint16_t);
17486__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnmatch_u8)))
17487svbool_t svnmatch_u8(svbool_t, svuint8_t, svuint8_t);
17488__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnmatch_u16)))
17489svbool_t svnmatch_u16(svbool_t, svuint16_t, svuint16_t);
17490__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnmatch_s8)))
17491svbool_t svnmatch_s8(svbool_t, svint8_t, svint8_t);
17492__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnmatch_s16)))
17493svbool_t svnmatch_s16(svbool_t, svint16_t, svint16_t);
17494__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmul_n_u8)))
17495svuint8_t svpmul_n_u8(svuint8_t, uint8_t);
17496__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmul_u8)))
17497svuint8_t svpmul_u8(svuint8_t, svuint8_t);
17498__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_n_u64)))
17499svuint64_t svpmullb_n_u64(svuint32_t, uint32_t);
17500__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_n_u16)))
17501svuint16_t svpmullb_n_u16(svuint8_t, uint8_t);
17502__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_u64)))
17503svuint64_t svpmullb_u64(svuint32_t, svuint32_t);
17504__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_u16)))
17505svuint16_t svpmullb_u16(svuint8_t, svuint8_t);
17506__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_pair_n_u8)))
17507svuint8_t svpmullb_pair_n_u8(svuint8_t, uint8_t);
17508__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_pair_n_u32)))
17509svuint32_t svpmullb_pair_n_u32(svuint32_t, uint32_t);
17510__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_pair_u8)))
17511svuint8_t svpmullb_pair_u8(svuint8_t, svuint8_t);
17512__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_pair_u32)))
17513svuint32_t svpmullb_pair_u32(svuint32_t, svuint32_t);
17514__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_n_u64)))
17515svuint64_t svpmullt_n_u64(svuint32_t, uint32_t);
17516__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_n_u16)))
17517svuint16_t svpmullt_n_u16(svuint8_t, uint8_t);
17518__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_u64)))
17519svuint64_t svpmullt_u64(svuint32_t, svuint32_t);
17520__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_u16)))
17521svuint16_t svpmullt_u16(svuint8_t, svuint8_t);
17522__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_pair_n_u8)))
17523svuint8_t svpmullt_pair_n_u8(svuint8_t, uint8_t);
17524__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_pair_n_u32)))
17525svuint32_t svpmullt_pair_n_u32(svuint32_t, uint32_t);
17526__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_pair_u8)))
17527svuint8_t svpmullt_pair_u8(svuint8_t, svuint8_t);
17528__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_pair_u32)))
17529svuint32_t svpmullt_pair_u32(svuint32_t, svuint32_t);
17530__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s8_m)))
17531svint8_t svqabs_s8_m(svint8_t, svbool_t, svint8_t);
17532__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s32_m)))
17533svint32_t svqabs_s32_m(svint32_t, svbool_t, svint32_t);
17534__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s64_m)))
17535svint64_t svqabs_s64_m(svint64_t, svbool_t, svint64_t);
17536__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s16_m)))
17537svint16_t svqabs_s16_m(svint16_t, svbool_t, svint16_t);
17538__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s8_x)))
17539svint8_t svqabs_s8_x(svbool_t, svint8_t);
17540__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s32_x)))
17541svint32_t svqabs_s32_x(svbool_t, svint32_t);
17542__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s64_x)))
17543svint64_t svqabs_s64_x(svbool_t, svint64_t);
17544__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s16_x)))
17545svint16_t svqabs_s16_x(svbool_t, svint16_t);
17546__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s8_z)))
17547svint8_t svqabs_s8_z(svbool_t, svint8_t);
17548__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s32_z)))
17549svint32_t svqabs_s32_z(svbool_t, svint32_t);
17550__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s64_z)))
17551svint64_t svqabs_s64_z(svbool_t, svint64_t);
17552__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s16_z)))
17553svint16_t svqabs_s16_z(svbool_t, svint16_t);
17554__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s8_m)))
17555svint8_t svqadd_n_s8_m(svbool_t, svint8_t, int8_t);
17556__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s32_m)))
17557svint32_t svqadd_n_s32_m(svbool_t, svint32_t, int32_t);
17558__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s64_m)))
17559svint64_t svqadd_n_s64_m(svbool_t, svint64_t, int64_t);
17560__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s16_m)))
17561svint16_t svqadd_n_s16_m(svbool_t, svint16_t, int16_t);
17562__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s8_x)))
17563svint8_t svqadd_n_s8_x(svbool_t, svint8_t, int8_t);
17564__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s32_x)))
17565svint32_t svqadd_n_s32_x(svbool_t, svint32_t, int32_t);
17566__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s64_x)))
17567svint64_t svqadd_n_s64_x(svbool_t, svint64_t, int64_t);
17568__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s16_x)))
17569svint16_t svqadd_n_s16_x(svbool_t, svint16_t, int16_t);
17570__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s8_z)))
17571svint8_t svqadd_n_s8_z(svbool_t, svint8_t, int8_t);
17572__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s32_z)))
17573svint32_t svqadd_n_s32_z(svbool_t, svint32_t, int32_t);
17574__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s64_z)))
17575svint64_t svqadd_n_s64_z(svbool_t, svint64_t, int64_t);
17576__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s16_z)))
17577svint16_t svqadd_n_s16_z(svbool_t, svint16_t, int16_t);
17578__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u8_m)))
17579svuint8_t svqadd_n_u8_m(svbool_t, svuint8_t, uint8_t);
17580__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u32_m)))
17581svuint32_t svqadd_n_u32_m(svbool_t, svuint32_t, uint32_t);
17582__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u64_m)))
17583svuint64_t svqadd_n_u64_m(svbool_t, svuint64_t, uint64_t);
17584__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u16_m)))
17585svuint16_t svqadd_n_u16_m(svbool_t, svuint16_t, uint16_t);
17586__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u8_x)))
17587svuint8_t svqadd_n_u8_x(svbool_t, svuint8_t, uint8_t);
17588__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u32_x)))
17589svuint32_t svqadd_n_u32_x(svbool_t, svuint32_t, uint32_t);
17590__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u64_x)))
17591svuint64_t svqadd_n_u64_x(svbool_t, svuint64_t, uint64_t);
17592__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u16_x)))
17593svuint16_t svqadd_n_u16_x(svbool_t, svuint16_t, uint16_t);
17594__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u8_z)))
17595svuint8_t svqadd_n_u8_z(svbool_t, svuint8_t, uint8_t);
17596__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u32_z)))
17597svuint32_t svqadd_n_u32_z(svbool_t, svuint32_t, uint32_t);
17598__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u64_z)))
17599svuint64_t svqadd_n_u64_z(svbool_t, svuint64_t, uint64_t);
17600__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u16_z)))
17601svuint16_t svqadd_n_u16_z(svbool_t, svuint16_t, uint16_t);
17602__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s8_m)))
17603svint8_t svqadd_s8_m(svbool_t, svint8_t, svint8_t);
17604__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s32_m)))
17605svint32_t svqadd_s32_m(svbool_t, svint32_t, svint32_t);
17606__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s64_m)))
17607svint64_t svqadd_s64_m(svbool_t, svint64_t, svint64_t);
17608__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s16_m)))
17609svint16_t svqadd_s16_m(svbool_t, svint16_t, svint16_t);
17610__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s8_x)))
17611svint8_t svqadd_s8_x(svbool_t, svint8_t, svint8_t);
17612__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s32_x)))
17613svint32_t svqadd_s32_x(svbool_t, svint32_t, svint32_t);
17614__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s64_x)))
17615svint64_t svqadd_s64_x(svbool_t, svint64_t, svint64_t);
17616__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s16_x)))
17617svint16_t svqadd_s16_x(svbool_t, svint16_t, svint16_t);
17618__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s8_z)))
17619svint8_t svqadd_s8_z(svbool_t, svint8_t, svint8_t);
17620__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s32_z)))
17621svint32_t svqadd_s32_z(svbool_t, svint32_t, svint32_t);
17622__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s64_z)))
17623svint64_t svqadd_s64_z(svbool_t, svint64_t, svint64_t);
17624__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s16_z)))
17625svint16_t svqadd_s16_z(svbool_t, svint16_t, svint16_t);
17626__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u8_m)))
17627svuint8_t svqadd_u8_m(svbool_t, svuint8_t, svuint8_t);
17628__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u32_m)))
17629svuint32_t svqadd_u32_m(svbool_t, svuint32_t, svuint32_t);
17630__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u64_m)))
17631svuint64_t svqadd_u64_m(svbool_t, svuint64_t, svuint64_t);
17632__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u16_m)))
17633svuint16_t svqadd_u16_m(svbool_t, svuint16_t, svuint16_t);
17634__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u8_x)))
17635svuint8_t svqadd_u8_x(svbool_t, svuint8_t, svuint8_t);
17636__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u32_x)))
17637svuint32_t svqadd_u32_x(svbool_t, svuint32_t, svuint32_t);
17638__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u64_x)))
17639svuint64_t svqadd_u64_x(svbool_t, svuint64_t, svuint64_t);
17640__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u16_x)))
17641svuint16_t svqadd_u16_x(svbool_t, svuint16_t, svuint16_t);
17642__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u8_z)))
17643svuint8_t svqadd_u8_z(svbool_t, svuint8_t, svuint8_t);
17644__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u32_z)))
17645svuint32_t svqadd_u32_z(svbool_t, svuint32_t, svuint32_t);
17646__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u64_z)))
17647svuint64_t svqadd_u64_z(svbool_t, svuint64_t, svuint64_t);
17648__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u16_z)))
17649svuint16_t svqadd_u16_z(svbool_t, svuint16_t, svuint16_t);
17650__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqcadd_s8)))
17651svint8_t svqcadd_s8(svint8_t, svint8_t, uint64_t);
17652__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqcadd_s32)))
17653svint32_t svqcadd_s32(svint32_t, svint32_t, uint64_t);
17654__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqcadd_s64)))
17655svint64_t svqcadd_s64(svint64_t, svint64_t, uint64_t);
17656__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqcadd_s16)))
17657svint16_t svqcadd_s16(svint16_t, svint16_t, uint64_t);
17658__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_n_s32)))
17659svint32_t svqdmlalb_n_s32(svint32_t, svint16_t, int16_t);
17660__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_n_s64)))
17661svint64_t svqdmlalb_n_s64(svint64_t, svint32_t, int32_t);
17662__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_n_s16)))
17663svint16_t svqdmlalb_n_s16(svint16_t, svint8_t, int8_t);
17664__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_s32)))
17665svint32_t svqdmlalb_s32(svint32_t, svint16_t, svint16_t);
17666__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_s64)))
17667svint64_t svqdmlalb_s64(svint64_t, svint32_t, svint32_t);
17668__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_s16)))
17669svint16_t svqdmlalb_s16(svint16_t, svint8_t, svint8_t);
17670__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_lane_s32)))
17671svint32_t svqdmlalb_lane_s32(svint32_t, svint16_t, svint16_t, uint64_t);
17672__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_lane_s64)))
17673svint64_t svqdmlalb_lane_s64(svint64_t, svint32_t, svint32_t, uint64_t);
17674__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalbt_n_s32)))
17675svint32_t svqdmlalbt_n_s32(svint32_t, svint16_t, int16_t);
17676__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalbt_n_s64)))
17677svint64_t svqdmlalbt_n_s64(svint64_t, svint32_t, int32_t);
17678__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalbt_n_s16)))
17679svint16_t svqdmlalbt_n_s16(svint16_t, svint8_t, int8_t);
17680__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalbt_s32)))
17681svint32_t svqdmlalbt_s32(svint32_t, svint16_t, svint16_t);
17682__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalbt_s64)))
17683svint64_t svqdmlalbt_s64(svint64_t, svint32_t, svint32_t);
17684__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalbt_s16)))
17685svint16_t svqdmlalbt_s16(svint16_t, svint8_t, svint8_t);
17686__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_n_s32)))
17687svint32_t svqdmlalt_n_s32(svint32_t, svint16_t, int16_t);
17688__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_n_s64)))
17689svint64_t svqdmlalt_n_s64(svint64_t, svint32_t, int32_t);
17690__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_n_s16)))
17691svint16_t svqdmlalt_n_s16(svint16_t, svint8_t, int8_t);
17692__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_s32)))
17693svint32_t svqdmlalt_s32(svint32_t, svint16_t, svint16_t);
17694__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_s64)))
17695svint64_t svqdmlalt_s64(svint64_t, svint32_t, svint32_t);
17696__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_s16)))
17697svint16_t svqdmlalt_s16(svint16_t, svint8_t, svint8_t);
17698__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_lane_s32)))
17699svint32_t svqdmlalt_lane_s32(svint32_t, svint16_t, svint16_t, uint64_t);
17700__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_lane_s64)))
17701svint64_t svqdmlalt_lane_s64(svint64_t, svint32_t, svint32_t, uint64_t);
17702__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_n_s32)))
17703svint32_t svqdmlslb_n_s32(svint32_t, svint16_t, int16_t);
17704__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_n_s64)))
17705svint64_t svqdmlslb_n_s64(svint64_t, svint32_t, int32_t);
17706__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_n_s16)))
17707svint16_t svqdmlslb_n_s16(svint16_t, svint8_t, int8_t);
17708__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_s32)))
17709svint32_t svqdmlslb_s32(svint32_t, svint16_t, svint16_t);
17710__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_s64)))
17711svint64_t svqdmlslb_s64(svint64_t, svint32_t, svint32_t);
17712__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_s16)))
17713svint16_t svqdmlslb_s16(svint16_t, svint8_t, svint8_t);
17714__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_lane_s32)))
17715svint32_t svqdmlslb_lane_s32(svint32_t, svint16_t, svint16_t, uint64_t);
17716__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_lane_s64)))
17717svint64_t svqdmlslb_lane_s64(svint64_t, svint32_t, svint32_t, uint64_t);
17718__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslbt_n_s32)))
17719svint32_t svqdmlslbt_n_s32(svint32_t, svint16_t, int16_t);
17720__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslbt_n_s64)))
17721svint64_t svqdmlslbt_n_s64(svint64_t, svint32_t, int32_t);
17722__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslbt_n_s16)))
17723svint16_t svqdmlslbt_n_s16(svint16_t, svint8_t, int8_t);
17724__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslbt_s32)))
17725svint32_t svqdmlslbt_s32(svint32_t, svint16_t, svint16_t);
17726__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslbt_s64)))
17727svint64_t svqdmlslbt_s64(svint64_t, svint32_t, svint32_t);
17728__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslbt_s16)))
17729svint16_t svqdmlslbt_s16(svint16_t, svint8_t, svint8_t);
17730__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_n_s32)))
17731svint32_t svqdmlslt_n_s32(svint32_t, svint16_t, int16_t);
17732__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_n_s64)))
17733svint64_t svqdmlslt_n_s64(svint64_t, svint32_t, int32_t);
17734__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_n_s16)))
17735svint16_t svqdmlslt_n_s16(svint16_t, svint8_t, int8_t);
17736__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_s32)))
17737svint32_t svqdmlslt_s32(svint32_t, svint16_t, svint16_t);
17738__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_s64)))
17739svint64_t svqdmlslt_s64(svint64_t, svint32_t, svint32_t);
17740__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_s16)))
17741svint16_t svqdmlslt_s16(svint16_t, svint8_t, svint8_t);
17742__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_lane_s32)))
17743svint32_t svqdmlslt_lane_s32(svint32_t, svint16_t, svint16_t, uint64_t);
17744__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_lane_s64)))
17745svint64_t svqdmlslt_lane_s64(svint64_t, svint32_t, svint32_t, uint64_t);
17746__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_n_s8)))
17747svint8_t svqdmulh_n_s8(svint8_t, int8_t);
17748__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_n_s32)))
17749svint32_t svqdmulh_n_s32(svint32_t, int32_t);
17750__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_n_s64)))
17751svint64_t svqdmulh_n_s64(svint64_t, int64_t);
17752__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_n_s16)))
17753svint16_t svqdmulh_n_s16(svint16_t, int16_t);
17754__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_s8)))
17755svint8_t svqdmulh_s8(svint8_t, svint8_t);
17756__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_s32)))
17757svint32_t svqdmulh_s32(svint32_t, svint32_t);
17758__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_s64)))
17759svint64_t svqdmulh_s64(svint64_t, svint64_t);
17760__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_s16)))
17761svint16_t svqdmulh_s16(svint16_t, svint16_t);
17762__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_lane_s32)))
17763svint32_t svqdmulh_lane_s32(svint32_t, svint32_t, uint64_t);
17764__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_lane_s64)))
17765svint64_t svqdmulh_lane_s64(svint64_t, svint64_t, uint64_t);
17766__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_lane_s16)))
17767svint16_t svqdmulh_lane_s16(svint16_t, svint16_t, uint64_t);
17768__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_n_s32)))
17769svint32_t svqdmullb_n_s32(svint16_t, int16_t);
17770__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_n_s64)))
17771svint64_t svqdmullb_n_s64(svint32_t, int32_t);
17772__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_n_s16)))
17773svint16_t svqdmullb_n_s16(svint8_t, int8_t);
17774__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_s32)))
17775svint32_t svqdmullb_s32(svint16_t, svint16_t);
17776__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_s64)))
17777svint64_t svqdmullb_s64(svint32_t, svint32_t);
17778__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_s16)))
17779svint16_t svqdmullb_s16(svint8_t, svint8_t);
17780__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_lane_s32)))
17781svint32_t svqdmullb_lane_s32(svint16_t, svint16_t, uint64_t);
17782__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_lane_s64)))
17783svint64_t svqdmullb_lane_s64(svint32_t, svint32_t, uint64_t);
17784__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_n_s32)))
17785svint32_t svqdmullt_n_s32(svint16_t, int16_t);
17786__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_n_s64)))
17787svint64_t svqdmullt_n_s64(svint32_t, int32_t);
17788__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_n_s16)))
17789svint16_t svqdmullt_n_s16(svint8_t, int8_t);
17790__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_s32)))
17791svint32_t svqdmullt_s32(svint16_t, svint16_t);
17792__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_s64)))
17793svint64_t svqdmullt_s64(svint32_t, svint32_t);
17794__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_s16)))
17795svint16_t svqdmullt_s16(svint8_t, svint8_t);
17796__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_lane_s32)))
17797svint32_t svqdmullt_lane_s32(svint16_t, svint16_t, uint64_t);
17798__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_lane_s64)))
17799svint64_t svqdmullt_lane_s64(svint32_t, svint32_t, uint64_t);
17800__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s8_m)))
17801svint8_t svqneg_s8_m(svint8_t, svbool_t, svint8_t);
17802__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s32_m)))
17803svint32_t svqneg_s32_m(svint32_t, svbool_t, svint32_t);
17804__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s64_m)))
17805svint64_t svqneg_s64_m(svint64_t, svbool_t, svint64_t);
17806__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s16_m)))
17807svint16_t svqneg_s16_m(svint16_t, svbool_t, svint16_t);
17808__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s8_x)))
17809svint8_t svqneg_s8_x(svbool_t, svint8_t);
17810__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s32_x)))
17811svint32_t svqneg_s32_x(svbool_t, svint32_t);
17812__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s64_x)))
17813svint64_t svqneg_s64_x(svbool_t, svint64_t);
17814__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s16_x)))
17815svint16_t svqneg_s16_x(svbool_t, svint16_t);
17816__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s8_z)))
17817svint8_t svqneg_s8_z(svbool_t, svint8_t);
17818__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s32_z)))
17819svint32_t svqneg_s32_z(svbool_t, svint32_t);
17820__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s64_z)))
17821svint64_t svqneg_s64_z(svbool_t, svint64_t);
17822__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s16_z)))
17823svint16_t svqneg_s16_z(svbool_t, svint16_t);
17824__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdcmlah_s8)))
17825svint8_t svqrdcmlah_s8(svint8_t, svint8_t, svint8_t, uint64_t);
17826__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdcmlah_s32)))
17827svint32_t svqrdcmlah_s32(svint32_t, svint32_t, svint32_t, uint64_t);
17828__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdcmlah_s64)))
17829svint64_t svqrdcmlah_s64(svint64_t, svint64_t, svint64_t, uint64_t);
17830__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdcmlah_s16)))
17831svint16_t svqrdcmlah_s16(svint16_t, svint16_t, svint16_t, uint64_t);
17832__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdcmlah_lane_s32)))
17833svint32_t svqrdcmlah_lane_s32(svint32_t, svint32_t, svint32_t, uint64_t, uint64_t);
17834__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdcmlah_lane_s16)))
17835svint16_t svqrdcmlah_lane_s16(svint16_t, svint16_t, svint16_t, uint64_t, uint64_t);
17836__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_n_s8)))
17837svint8_t svqrdmlah_n_s8(svint8_t, svint8_t, int8_t);
17838__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_n_s32)))
17839svint32_t svqrdmlah_n_s32(svint32_t, svint32_t, int32_t);
17840__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_n_s64)))
17841svint64_t svqrdmlah_n_s64(svint64_t, svint64_t, int64_t);
17842__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_n_s16)))
17843svint16_t svqrdmlah_n_s16(svint16_t, svint16_t, int16_t);
17844__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_s8)))
17845svint8_t svqrdmlah_s8(svint8_t, svint8_t, svint8_t);
17846__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_s32)))
17847svint32_t svqrdmlah_s32(svint32_t, svint32_t, svint32_t);
17848__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_s64)))
17849svint64_t svqrdmlah_s64(svint64_t, svint64_t, svint64_t);
17850__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_s16)))
17851svint16_t svqrdmlah_s16(svint16_t, svint16_t, svint16_t);
17852__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_lane_s32)))
17853svint32_t svqrdmlah_lane_s32(svint32_t, svint32_t, svint32_t, uint64_t);
17854__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_lane_s64)))
17855svint64_t svqrdmlah_lane_s64(svint64_t, svint64_t, svint64_t, uint64_t);
17856__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_lane_s16)))
17857svint16_t svqrdmlah_lane_s16(svint16_t, svint16_t, svint16_t, uint64_t);
17858__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_n_s8)))
17859svint8_t svqrdmlsh_n_s8(svint8_t, svint8_t, int8_t);
17860__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_n_s32)))
17861svint32_t svqrdmlsh_n_s32(svint32_t, svint32_t, int32_t);
17862__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_n_s64)))
17863svint64_t svqrdmlsh_n_s64(svint64_t, svint64_t, int64_t);
17864__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_n_s16)))
17865svint16_t svqrdmlsh_n_s16(svint16_t, svint16_t, int16_t);
17866__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_s8)))
17867svint8_t svqrdmlsh_s8(svint8_t, svint8_t, svint8_t);
17868__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_s32)))
17869svint32_t svqrdmlsh_s32(svint32_t, svint32_t, svint32_t);
17870__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_s64)))
17871svint64_t svqrdmlsh_s64(svint64_t, svint64_t, svint64_t);
17872__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_s16)))
17873svint16_t svqrdmlsh_s16(svint16_t, svint16_t, svint16_t);
17874__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_lane_s32)))
17875svint32_t svqrdmlsh_lane_s32(svint32_t, svint32_t, svint32_t, uint64_t);
17876__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_lane_s64)))
17877svint64_t svqrdmlsh_lane_s64(svint64_t, svint64_t, svint64_t, uint64_t);
17878__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_lane_s16)))
17879svint16_t svqrdmlsh_lane_s16(svint16_t, svint16_t, svint16_t, uint64_t);
17880__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_n_s8)))
17881svint8_t svqrdmulh_n_s8(svint8_t, int8_t);
17882__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_n_s32)))
17883svint32_t svqrdmulh_n_s32(svint32_t, int32_t);
17884__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_n_s64)))
17885svint64_t svqrdmulh_n_s64(svint64_t, int64_t);
17886__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_n_s16)))
17887svint16_t svqrdmulh_n_s16(svint16_t, int16_t);
17888__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_s8)))
17889svint8_t svqrdmulh_s8(svint8_t, svint8_t);
17890__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_s32)))
17891svint32_t svqrdmulh_s32(svint32_t, svint32_t);
17892__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_s64)))
17893svint64_t svqrdmulh_s64(svint64_t, svint64_t);
17894__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_s16)))
17895svint16_t svqrdmulh_s16(svint16_t, svint16_t);
17896__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_lane_s32)))
17897svint32_t svqrdmulh_lane_s32(svint32_t, svint32_t, uint64_t);
17898__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_lane_s64)))
17899svint64_t svqrdmulh_lane_s64(svint64_t, svint64_t, uint64_t);
17900__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_lane_s16)))
17901svint16_t svqrdmulh_lane_s16(svint16_t, svint16_t, uint64_t);
17902__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s8_m)))
17903svint8_t svqrshl_n_s8_m(svbool_t, svint8_t, int8_t);
17904__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s32_m)))
17905svint32_t svqrshl_n_s32_m(svbool_t, svint32_t, int32_t);
17906__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s64_m)))
17907svint64_t svqrshl_n_s64_m(svbool_t, svint64_t, int64_t);
17908__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s16_m)))
17909svint16_t svqrshl_n_s16_m(svbool_t, svint16_t, int16_t);
17910__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s8_x)))
17911svint8_t svqrshl_n_s8_x(svbool_t, svint8_t, int8_t);
17912__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s32_x)))
17913svint32_t svqrshl_n_s32_x(svbool_t, svint32_t, int32_t);
17914__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s64_x)))
17915svint64_t svqrshl_n_s64_x(svbool_t, svint64_t, int64_t);
17916__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s16_x)))
17917svint16_t svqrshl_n_s16_x(svbool_t, svint16_t, int16_t);
17918__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s8_z)))
17919svint8_t svqrshl_n_s8_z(svbool_t, svint8_t, int8_t);
17920__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s32_z)))
17921svint32_t svqrshl_n_s32_z(svbool_t, svint32_t, int32_t);
17922__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s64_z)))
17923svint64_t svqrshl_n_s64_z(svbool_t, svint64_t, int64_t);
17924__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s16_z)))
17925svint16_t svqrshl_n_s16_z(svbool_t, svint16_t, int16_t);
17926__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u8_m)))
17927svuint8_t svqrshl_n_u8_m(svbool_t, svuint8_t, int8_t);
17928__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u32_m)))
17929svuint32_t svqrshl_n_u32_m(svbool_t, svuint32_t, int32_t);
17930__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u64_m)))
17931svuint64_t svqrshl_n_u64_m(svbool_t, svuint64_t, int64_t);
17932__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u16_m)))
17933svuint16_t svqrshl_n_u16_m(svbool_t, svuint16_t, int16_t);
17934__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u8_x)))
17935svuint8_t svqrshl_n_u8_x(svbool_t, svuint8_t, int8_t);
17936__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u32_x)))
17937svuint32_t svqrshl_n_u32_x(svbool_t, svuint32_t, int32_t);
17938__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u64_x)))
17939svuint64_t svqrshl_n_u64_x(svbool_t, svuint64_t, int64_t);
17940__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u16_x)))
17941svuint16_t svqrshl_n_u16_x(svbool_t, svuint16_t, int16_t);
17942__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u8_z)))
17943svuint8_t svqrshl_n_u8_z(svbool_t, svuint8_t, int8_t);
17944__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u32_z)))
17945svuint32_t svqrshl_n_u32_z(svbool_t, svuint32_t, int32_t);
17946__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u64_z)))
17947svuint64_t svqrshl_n_u64_z(svbool_t, svuint64_t, int64_t);
17948__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u16_z)))
17949svuint16_t svqrshl_n_u16_z(svbool_t, svuint16_t, int16_t);
17950__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s8_m)))
17951svint8_t svqrshl_s8_m(svbool_t, svint8_t, svint8_t);
17952__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s32_m)))
17953svint32_t svqrshl_s32_m(svbool_t, svint32_t, svint32_t);
17954__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s64_m)))
17955svint64_t svqrshl_s64_m(svbool_t, svint64_t, svint64_t);
17956__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s16_m)))
17957svint16_t svqrshl_s16_m(svbool_t, svint16_t, svint16_t);
17958__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s8_x)))
17959svint8_t svqrshl_s8_x(svbool_t, svint8_t, svint8_t);
17960__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s32_x)))
17961svint32_t svqrshl_s32_x(svbool_t, svint32_t, svint32_t);
17962__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s64_x)))
17963svint64_t svqrshl_s64_x(svbool_t, svint64_t, svint64_t);
17964__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s16_x)))
17965svint16_t svqrshl_s16_x(svbool_t, svint16_t, svint16_t);
17966__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s8_z)))
17967svint8_t svqrshl_s8_z(svbool_t, svint8_t, svint8_t);
17968__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s32_z)))
17969svint32_t svqrshl_s32_z(svbool_t, svint32_t, svint32_t);
17970__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s64_z)))
17971svint64_t svqrshl_s64_z(svbool_t, svint64_t, svint64_t);
17972__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s16_z)))
17973svint16_t svqrshl_s16_z(svbool_t, svint16_t, svint16_t);
17974__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u8_m)))
17975svuint8_t svqrshl_u8_m(svbool_t, svuint8_t, svint8_t);
17976__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u32_m)))
17977svuint32_t svqrshl_u32_m(svbool_t, svuint32_t, svint32_t);
17978__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u64_m)))
17979svuint64_t svqrshl_u64_m(svbool_t, svuint64_t, svint64_t);
17980__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u16_m)))
17981svuint16_t svqrshl_u16_m(svbool_t, svuint16_t, svint16_t);
17982__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u8_x)))
17983svuint8_t svqrshl_u8_x(svbool_t, svuint8_t, svint8_t);
17984__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u32_x)))
17985svuint32_t svqrshl_u32_x(svbool_t, svuint32_t, svint32_t);
17986__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u64_x)))
17987svuint64_t svqrshl_u64_x(svbool_t, svuint64_t, svint64_t);
17988__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u16_x)))
17989svuint16_t svqrshl_u16_x(svbool_t, svuint16_t, svint16_t);
17990__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u8_z)))
17991svuint8_t svqrshl_u8_z(svbool_t, svuint8_t, svint8_t);
17992__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u32_z)))
17993svuint32_t svqrshl_u32_z(svbool_t, svuint32_t, svint32_t);
17994__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u64_z)))
17995svuint64_t svqrshl_u64_z(svbool_t, svuint64_t, svint64_t);
17996__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u16_z)))
17997svuint16_t svqrshl_u16_z(svbool_t, svuint16_t, svint16_t);
17998__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnb_n_s32)))
17999svint16_t svqrshrnb_n_s32(svint32_t, uint64_t);
18000__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnb_n_s64)))
18001svint32_t svqrshrnb_n_s64(svint64_t, uint64_t);
18002__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnb_n_s16)))
18003svint8_t svqrshrnb_n_s16(svint16_t, uint64_t);
18004__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnb_n_u32)))
18005svuint16_t svqrshrnb_n_u32(svuint32_t, uint64_t);
18006__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnb_n_u64)))
18007svuint32_t svqrshrnb_n_u64(svuint64_t, uint64_t);
18008__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnb_n_u16)))
18009svuint8_t svqrshrnb_n_u16(svuint16_t, uint64_t);
18010__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnt_n_s32)))
18011svint16_t svqrshrnt_n_s32(svint16_t, svint32_t, uint64_t);
18012__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnt_n_s64)))
18013svint32_t svqrshrnt_n_s64(svint32_t, svint64_t, uint64_t);
18014__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnt_n_s16)))
18015svint8_t svqrshrnt_n_s16(svint8_t, svint16_t, uint64_t);
18016__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnt_n_u32)))
18017svuint16_t svqrshrnt_n_u32(svuint16_t, svuint32_t, uint64_t);
18018__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnt_n_u64)))
18019svuint32_t svqrshrnt_n_u64(svuint32_t, svuint64_t, uint64_t);
18020__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnt_n_u16)))
18021svuint8_t svqrshrnt_n_u16(svuint8_t, svuint16_t, uint64_t);
18022__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrunb_n_s32)))
18023svuint16_t svqrshrunb_n_s32(svint32_t, uint64_t);
18024__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrunb_n_s64)))
18025svuint32_t svqrshrunb_n_s64(svint64_t, uint64_t);
18026__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrunb_n_s16)))
18027svuint8_t svqrshrunb_n_s16(svint16_t, uint64_t);
18028__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrunt_n_s32)))
18029svuint16_t svqrshrunt_n_s32(svuint16_t, svint32_t, uint64_t);
18030__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrunt_n_s64)))
18031svuint32_t svqrshrunt_n_s64(svuint32_t, svint64_t, uint64_t);
18032__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrunt_n_s16)))
18033svuint8_t svqrshrunt_n_s16(svuint8_t, svint16_t, uint64_t);
18034__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s8_m)))
18035svint8_t svqshl_n_s8_m(svbool_t, svint8_t, int8_t);
18036__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s32_m)))
18037svint32_t svqshl_n_s32_m(svbool_t, svint32_t, int32_t);
18038__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s64_m)))
18039svint64_t svqshl_n_s64_m(svbool_t, svint64_t, int64_t);
18040__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s16_m)))
18041svint16_t svqshl_n_s16_m(svbool_t, svint16_t, int16_t);
18042__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s8_x)))
18043svint8_t svqshl_n_s8_x(svbool_t, svint8_t, int8_t);
18044__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s32_x)))
18045svint32_t svqshl_n_s32_x(svbool_t, svint32_t, int32_t);
18046__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s64_x)))
18047svint64_t svqshl_n_s64_x(svbool_t, svint64_t, int64_t);
18048__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s16_x)))
18049svint16_t svqshl_n_s16_x(svbool_t, svint16_t, int16_t);
18050__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s8_z)))
18051svint8_t svqshl_n_s8_z(svbool_t, svint8_t, int8_t);
18052__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s32_z)))
18053svint32_t svqshl_n_s32_z(svbool_t, svint32_t, int32_t);
18054__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s64_z)))
18055svint64_t svqshl_n_s64_z(svbool_t, svint64_t, int64_t);
18056__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s16_z)))
18057svint16_t svqshl_n_s16_z(svbool_t, svint16_t, int16_t);
18058__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u8_m)))
18059svuint8_t svqshl_n_u8_m(svbool_t, svuint8_t, int8_t);
18060__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u32_m)))
18061svuint32_t svqshl_n_u32_m(svbool_t, svuint32_t, int32_t);
18062__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u64_m)))
18063svuint64_t svqshl_n_u64_m(svbool_t, svuint64_t, int64_t);
18064__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u16_m)))
18065svuint16_t svqshl_n_u16_m(svbool_t, svuint16_t, int16_t);
18066__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u8_x)))
18067svuint8_t svqshl_n_u8_x(svbool_t, svuint8_t, int8_t);
18068__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u32_x)))
18069svuint32_t svqshl_n_u32_x(svbool_t, svuint32_t, int32_t);
18070__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u64_x)))
18071svuint64_t svqshl_n_u64_x(svbool_t, svuint64_t, int64_t);
18072__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u16_x)))
18073svuint16_t svqshl_n_u16_x(svbool_t, svuint16_t, int16_t);
18074__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u8_z)))
18075svuint8_t svqshl_n_u8_z(svbool_t, svuint8_t, int8_t);
18076__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u32_z)))
18077svuint32_t svqshl_n_u32_z(svbool_t, svuint32_t, int32_t);
18078__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u64_z)))
18079svuint64_t svqshl_n_u64_z(svbool_t, svuint64_t, int64_t);
18080__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u16_z)))
18081svuint16_t svqshl_n_u16_z(svbool_t, svuint16_t, int16_t);
18082__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s8_m)))
18083svint8_t svqshl_s8_m(svbool_t, svint8_t, svint8_t);
18084__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s32_m)))
18085svint32_t svqshl_s32_m(svbool_t, svint32_t, svint32_t);
18086__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s64_m)))
18087svint64_t svqshl_s64_m(svbool_t, svint64_t, svint64_t);
18088__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s16_m)))
18089svint16_t svqshl_s16_m(svbool_t, svint16_t, svint16_t);
18090__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s8_x)))
18091svint8_t svqshl_s8_x(svbool_t, svint8_t, svint8_t);
18092__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s32_x)))
18093svint32_t svqshl_s32_x(svbool_t, svint32_t, svint32_t);
18094__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s64_x)))
18095svint64_t svqshl_s64_x(svbool_t, svint64_t, svint64_t);
18096__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s16_x)))
18097svint16_t svqshl_s16_x(svbool_t, svint16_t, svint16_t);
18098__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s8_z)))
18099svint8_t svqshl_s8_z(svbool_t, svint8_t, svint8_t);
18100__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s32_z)))
18101svint32_t svqshl_s32_z(svbool_t, svint32_t, svint32_t);
18102__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s64_z)))
18103svint64_t svqshl_s64_z(svbool_t, svint64_t, svint64_t);
18104__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s16_z)))
18105svint16_t svqshl_s16_z(svbool_t, svint16_t, svint16_t);
18106__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u8_m)))
18107svuint8_t svqshl_u8_m(svbool_t, svuint8_t, svint8_t);
18108__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u32_m)))
18109svuint32_t svqshl_u32_m(svbool_t, svuint32_t, svint32_t);
18110__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u64_m)))
18111svuint64_t svqshl_u64_m(svbool_t, svuint64_t, svint64_t);
18112__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u16_m)))
18113svuint16_t svqshl_u16_m(svbool_t, svuint16_t, svint16_t);
18114__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u8_x)))
18115svuint8_t svqshl_u8_x(svbool_t, svuint8_t, svint8_t);
18116__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u32_x)))
18117svuint32_t svqshl_u32_x(svbool_t, svuint32_t, svint32_t);
18118__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u64_x)))
18119svuint64_t svqshl_u64_x(svbool_t, svuint64_t, svint64_t);
18120__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u16_x)))
18121svuint16_t svqshl_u16_x(svbool_t, svuint16_t, svint16_t);
18122__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u8_z)))
18123svuint8_t svqshl_u8_z(svbool_t, svuint8_t, svint8_t);
18124__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u32_z)))
18125svuint32_t svqshl_u32_z(svbool_t, svuint32_t, svint32_t);
18126__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u64_z)))
18127svuint64_t svqshl_u64_z(svbool_t, svuint64_t, svint64_t);
18128__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u16_z)))
18129svuint16_t svqshl_u16_z(svbool_t, svuint16_t, svint16_t);
18130__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s8_m)))
18131svuint8_t svqshlu_n_s8_m(svbool_t, svint8_t, uint64_t);
18132__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s32_m)))
18133svuint32_t svqshlu_n_s32_m(svbool_t, svint32_t, uint64_t);
18134__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s64_m)))
18135svuint64_t svqshlu_n_s64_m(svbool_t, svint64_t, uint64_t);
18136__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s16_m)))
18137svuint16_t svqshlu_n_s16_m(svbool_t, svint16_t, uint64_t);
18138__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s8_x)))
18139svuint8_t svqshlu_n_s8_x(svbool_t, svint8_t, uint64_t);
18140__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s32_x)))
18141svuint32_t svqshlu_n_s32_x(svbool_t, svint32_t, uint64_t);
18142__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s64_x)))
18143svuint64_t svqshlu_n_s64_x(svbool_t, svint64_t, uint64_t);
18144__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s16_x)))
18145svuint16_t svqshlu_n_s16_x(svbool_t, svint16_t, uint64_t);
18146__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s8_z)))
18147svuint8_t svqshlu_n_s8_z(svbool_t, svint8_t, uint64_t);
18148__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s32_z)))
18149svuint32_t svqshlu_n_s32_z(svbool_t, svint32_t, uint64_t);
18150__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s64_z)))
18151svuint64_t svqshlu_n_s64_z(svbool_t, svint64_t, uint64_t);
18152__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s16_z)))
18153svuint16_t svqshlu_n_s16_z(svbool_t, svint16_t, uint64_t);
18154__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnb_n_s32)))
18155svint16_t svqshrnb_n_s32(svint32_t, uint64_t);
18156__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnb_n_s64)))
18157svint32_t svqshrnb_n_s64(svint64_t, uint64_t);
18158__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnb_n_s16)))
18159svint8_t svqshrnb_n_s16(svint16_t, uint64_t);
18160__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnb_n_u32)))
18161svuint16_t svqshrnb_n_u32(svuint32_t, uint64_t);
18162__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnb_n_u64)))
18163svuint32_t svqshrnb_n_u64(svuint64_t, uint64_t);
18164__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnb_n_u16)))
18165svuint8_t svqshrnb_n_u16(svuint16_t, uint64_t);
18166__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnt_n_s32)))
18167svint16_t svqshrnt_n_s32(svint16_t, svint32_t, uint64_t);
18168__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnt_n_s64)))
18169svint32_t svqshrnt_n_s64(svint32_t, svint64_t, uint64_t);
18170__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnt_n_s16)))
18171svint8_t svqshrnt_n_s16(svint8_t, svint16_t, uint64_t);
18172__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnt_n_u32)))
18173svuint16_t svqshrnt_n_u32(svuint16_t, svuint32_t, uint64_t);
18174__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnt_n_u64)))
18175svuint32_t svqshrnt_n_u64(svuint32_t, svuint64_t, uint64_t);
18176__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnt_n_u16)))
18177svuint8_t svqshrnt_n_u16(svuint8_t, svuint16_t, uint64_t);
18178__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrunb_n_s32)))
18179svuint16_t svqshrunb_n_s32(svint32_t, uint64_t);
18180__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrunb_n_s64)))
18181svuint32_t svqshrunb_n_s64(svint64_t, uint64_t);
18182__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrunb_n_s16)))
18183svuint8_t svqshrunb_n_s16(svint16_t, uint64_t);
18184__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrunt_n_s32)))
18185svuint16_t svqshrunt_n_s32(svuint16_t, svint32_t, uint64_t);
18186__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrunt_n_s64)))
18187svuint32_t svqshrunt_n_s64(svuint32_t, svint64_t, uint64_t);
18188__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrunt_n_s16)))
18189svuint8_t svqshrunt_n_s16(svuint8_t, svint16_t, uint64_t);
18190__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s8_m)))
18191svint8_t svqsub_n_s8_m(svbool_t, svint8_t, int8_t);
18192__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s32_m)))
18193svint32_t svqsub_n_s32_m(svbool_t, svint32_t, int32_t);
18194__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s64_m)))
18195svint64_t svqsub_n_s64_m(svbool_t, svint64_t, int64_t);
18196__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s16_m)))
18197svint16_t svqsub_n_s16_m(svbool_t, svint16_t, int16_t);
18198__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s8_x)))
18199svint8_t svqsub_n_s8_x(svbool_t, svint8_t, int8_t);
18200__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s32_x)))
18201svint32_t svqsub_n_s32_x(svbool_t, svint32_t, int32_t);
18202__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s64_x)))
18203svint64_t svqsub_n_s64_x(svbool_t, svint64_t, int64_t);
18204__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s16_x)))
18205svint16_t svqsub_n_s16_x(svbool_t, svint16_t, int16_t);
18206__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s8_z)))
18207svint8_t svqsub_n_s8_z(svbool_t, svint8_t, int8_t);
18208__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s32_z)))
18209svint32_t svqsub_n_s32_z(svbool_t, svint32_t, int32_t);
18210__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s64_z)))
18211svint64_t svqsub_n_s64_z(svbool_t, svint64_t, int64_t);
18212__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s16_z)))
18213svint16_t svqsub_n_s16_z(svbool_t, svint16_t, int16_t);
18214__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u8_m)))
18215svuint8_t svqsub_n_u8_m(svbool_t, svuint8_t, uint8_t);
18216__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u32_m)))
18217svuint32_t svqsub_n_u32_m(svbool_t, svuint32_t, uint32_t);
18218__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u64_m)))
18219svuint64_t svqsub_n_u64_m(svbool_t, svuint64_t, uint64_t);
18220__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u16_m)))
18221svuint16_t svqsub_n_u16_m(svbool_t, svuint16_t, uint16_t);
18222__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u8_x)))
18223svuint8_t svqsub_n_u8_x(svbool_t, svuint8_t, uint8_t);
18224__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u32_x)))
18225svuint32_t svqsub_n_u32_x(svbool_t, svuint32_t, uint32_t);
18226__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u64_x)))
18227svuint64_t svqsub_n_u64_x(svbool_t, svuint64_t, uint64_t);
18228__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u16_x)))
18229svuint16_t svqsub_n_u16_x(svbool_t, svuint16_t, uint16_t);
18230__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u8_z)))
18231svuint8_t svqsub_n_u8_z(svbool_t, svuint8_t, uint8_t);
18232__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u32_z)))
18233svuint32_t svqsub_n_u32_z(svbool_t, svuint32_t, uint32_t);
18234__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u64_z)))
18235svuint64_t svqsub_n_u64_z(svbool_t, svuint64_t, uint64_t);
18236__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u16_z)))
18237svuint16_t svqsub_n_u16_z(svbool_t, svuint16_t, uint16_t);
18238__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s8_m)))
18239svint8_t svqsub_s8_m(svbool_t, svint8_t, svint8_t);
18240__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s32_m)))
18241svint32_t svqsub_s32_m(svbool_t, svint32_t, svint32_t);
18242__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s64_m)))
18243svint64_t svqsub_s64_m(svbool_t, svint64_t, svint64_t);
18244__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s16_m)))
18245svint16_t svqsub_s16_m(svbool_t, svint16_t, svint16_t);
18246__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s8_x)))
18247svint8_t svqsub_s8_x(svbool_t, svint8_t, svint8_t);
18248__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s32_x)))
18249svint32_t svqsub_s32_x(svbool_t, svint32_t, svint32_t);
18250__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s64_x)))
18251svint64_t svqsub_s64_x(svbool_t, svint64_t, svint64_t);
18252__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s16_x)))
18253svint16_t svqsub_s16_x(svbool_t, svint16_t, svint16_t);
18254__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s8_z)))
18255svint8_t svqsub_s8_z(svbool_t, svint8_t, svint8_t);
18256__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s32_z)))
18257svint32_t svqsub_s32_z(svbool_t, svint32_t, svint32_t);
18258__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s64_z)))
18259svint64_t svqsub_s64_z(svbool_t, svint64_t, svint64_t);
18260__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s16_z)))
18261svint16_t svqsub_s16_z(svbool_t, svint16_t, svint16_t);
18262__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u8_m)))
18263svuint8_t svqsub_u8_m(svbool_t, svuint8_t, svuint8_t);
18264__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u32_m)))
18265svuint32_t svqsub_u32_m(svbool_t, svuint32_t, svuint32_t);
18266__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u64_m)))
18267svuint64_t svqsub_u64_m(svbool_t, svuint64_t, svuint64_t);
18268__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u16_m)))
18269svuint16_t svqsub_u16_m(svbool_t, svuint16_t, svuint16_t);
18270__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u8_x)))
18271svuint8_t svqsub_u8_x(svbool_t, svuint8_t, svuint8_t);
18272__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u32_x)))
18273svuint32_t svqsub_u32_x(svbool_t, svuint32_t, svuint32_t);
18274__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u64_x)))
18275svuint64_t svqsub_u64_x(svbool_t, svuint64_t, svuint64_t);
18276__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u16_x)))
18277svuint16_t svqsub_u16_x(svbool_t, svuint16_t, svuint16_t);
18278__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u8_z)))
18279svuint8_t svqsub_u8_z(svbool_t, svuint8_t, svuint8_t);
18280__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u32_z)))
18281svuint32_t svqsub_u32_z(svbool_t, svuint32_t, svuint32_t);
18282__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u64_z)))
18283svuint64_t svqsub_u64_z(svbool_t, svuint64_t, svuint64_t);
18284__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u16_z)))
18285svuint16_t svqsub_u16_z(svbool_t, svuint16_t, svuint16_t);
18286__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s8_m)))
18287svint8_t svqsubr_n_s8_m(svbool_t, svint8_t, int8_t);
18288__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s32_m)))
18289svint32_t svqsubr_n_s32_m(svbool_t, svint32_t, int32_t);
18290__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s64_m)))
18291svint64_t svqsubr_n_s64_m(svbool_t, svint64_t, int64_t);
18292__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s16_m)))
18293svint16_t svqsubr_n_s16_m(svbool_t, svint16_t, int16_t);
18294__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s8_x)))
18295svint8_t svqsubr_n_s8_x(svbool_t, svint8_t, int8_t);
18296__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s32_x)))
18297svint32_t svqsubr_n_s32_x(svbool_t, svint32_t, int32_t);
18298__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s64_x)))
18299svint64_t svqsubr_n_s64_x(svbool_t, svint64_t, int64_t);
18300__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s16_x)))
18301svint16_t svqsubr_n_s16_x(svbool_t, svint16_t, int16_t);
18302__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s8_z)))
18303svint8_t svqsubr_n_s8_z(svbool_t, svint8_t, int8_t);
18304__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s32_z)))
18305svint32_t svqsubr_n_s32_z(svbool_t, svint32_t, int32_t);
18306__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s64_z)))
18307svint64_t svqsubr_n_s64_z(svbool_t, svint64_t, int64_t);
18308__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s16_z)))
18309svint16_t svqsubr_n_s16_z(svbool_t, svint16_t, int16_t);
18310__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u8_m)))
18311svuint8_t svqsubr_n_u8_m(svbool_t, svuint8_t, uint8_t);
18312__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u32_m)))
18313svuint32_t svqsubr_n_u32_m(svbool_t, svuint32_t, uint32_t);
18314__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u64_m)))
18315svuint64_t svqsubr_n_u64_m(svbool_t, svuint64_t, uint64_t);
18316__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u16_m)))
18317svuint16_t svqsubr_n_u16_m(svbool_t, svuint16_t, uint16_t);
18318__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u8_x)))
18319svuint8_t svqsubr_n_u8_x(svbool_t, svuint8_t, uint8_t);
18320__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u32_x)))
18321svuint32_t svqsubr_n_u32_x(svbool_t, svuint32_t, uint32_t);
18322__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u64_x)))
18323svuint64_t svqsubr_n_u64_x(svbool_t, svuint64_t, uint64_t);
18324__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u16_x)))
18325svuint16_t svqsubr_n_u16_x(svbool_t, svuint16_t, uint16_t);
18326__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u8_z)))
18327svuint8_t svqsubr_n_u8_z(svbool_t, svuint8_t, uint8_t);
18328__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u32_z)))
18329svuint32_t svqsubr_n_u32_z(svbool_t, svuint32_t, uint32_t);
18330__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u64_z)))
18331svuint64_t svqsubr_n_u64_z(svbool_t, svuint64_t, uint64_t);
18332__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u16_z)))
18333svuint16_t svqsubr_n_u16_z(svbool_t, svuint16_t, uint16_t);
18334__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s8_m)))
18335svint8_t svqsubr_s8_m(svbool_t, svint8_t, svint8_t);
18336__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s32_m)))
18337svint32_t svqsubr_s32_m(svbool_t, svint32_t, svint32_t);
18338__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s64_m)))
18339svint64_t svqsubr_s64_m(svbool_t, svint64_t, svint64_t);
18340__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s16_m)))
18341svint16_t svqsubr_s16_m(svbool_t, svint16_t, svint16_t);
18342__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s8_x)))
18343svint8_t svqsubr_s8_x(svbool_t, svint8_t, svint8_t);
18344__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s32_x)))
18345svint32_t svqsubr_s32_x(svbool_t, svint32_t, svint32_t);
18346__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s64_x)))
18347svint64_t svqsubr_s64_x(svbool_t, svint64_t, svint64_t);
18348__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s16_x)))
18349svint16_t svqsubr_s16_x(svbool_t, svint16_t, svint16_t);
18350__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s8_z)))
18351svint8_t svqsubr_s8_z(svbool_t, svint8_t, svint8_t);
18352__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s32_z)))
18353svint32_t svqsubr_s32_z(svbool_t, svint32_t, svint32_t);
18354__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s64_z)))
18355svint64_t svqsubr_s64_z(svbool_t, svint64_t, svint64_t);
18356__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s16_z)))
18357svint16_t svqsubr_s16_z(svbool_t, svint16_t, svint16_t);
18358__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u8_m)))
18359svuint8_t svqsubr_u8_m(svbool_t, svuint8_t, svuint8_t);
18360__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u32_m)))
18361svuint32_t svqsubr_u32_m(svbool_t, svuint32_t, svuint32_t);
18362__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u64_m)))
18363svuint64_t svqsubr_u64_m(svbool_t, svuint64_t, svuint64_t);
18364__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u16_m)))
18365svuint16_t svqsubr_u16_m(svbool_t, svuint16_t, svuint16_t);
18366__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u8_x)))
18367svuint8_t svqsubr_u8_x(svbool_t, svuint8_t, svuint8_t);
18368__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u32_x)))
18369svuint32_t svqsubr_u32_x(svbool_t, svuint32_t, svuint32_t);
18370__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u64_x)))
18371svuint64_t svqsubr_u64_x(svbool_t, svuint64_t, svuint64_t);
18372__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u16_x)))
18373svuint16_t svqsubr_u16_x(svbool_t, svuint16_t, svuint16_t);
18374__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u8_z)))
18375svuint8_t svqsubr_u8_z(svbool_t, svuint8_t, svuint8_t);
18376__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u32_z)))
18377svuint32_t svqsubr_u32_z(svbool_t, svuint32_t, svuint32_t);
18378__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u64_z)))
18379svuint64_t svqsubr_u64_z(svbool_t, svuint64_t, svuint64_t);
18380__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u16_z)))
18381svuint16_t svqsubr_u16_z(svbool_t, svuint16_t, svuint16_t);
18382__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnb_s32)))
18383svint16_t svqxtnb_s32(svint32_t);
18384__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnb_s64)))
18385svint32_t svqxtnb_s64(svint64_t);
18386__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnb_s16)))
18387svint8_t svqxtnb_s16(svint16_t);
18388__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnb_u32)))
18389svuint16_t svqxtnb_u32(svuint32_t);
18390__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnb_u64)))
18391svuint32_t svqxtnb_u64(svuint64_t);
18392__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnb_u16)))
18393svuint8_t svqxtnb_u16(svuint16_t);
18394__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnt_s32)))
18395svint16_t svqxtnt_s32(svint16_t, svint32_t);
18396__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnt_s64)))
18397svint32_t svqxtnt_s64(svint32_t, svint64_t);
18398__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnt_s16)))
18399svint8_t svqxtnt_s16(svint8_t, svint16_t);
18400__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnt_u32)))
18401svuint16_t svqxtnt_u32(svuint16_t, svuint32_t);
18402__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnt_u64)))
18403svuint32_t svqxtnt_u64(svuint32_t, svuint64_t);
18404__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnt_u16)))
18405svuint8_t svqxtnt_u16(svuint8_t, svuint16_t);
18406__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtunb_s32)))
18407svuint16_t svqxtunb_s32(svint32_t);
18408__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtunb_s64)))
18409svuint32_t svqxtunb_s64(svint64_t);
18410__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtunb_s16)))
18411svuint8_t svqxtunb_s16(svint16_t);
18412__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtunt_s32)))
18413svuint16_t svqxtunt_s32(svuint16_t, svint32_t);
18414__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtunt_s64)))
18415svuint32_t svqxtunt_s64(svuint32_t, svint64_t);
18416__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtunt_s16)))
18417svuint8_t svqxtunt_s16(svuint8_t, svint16_t);
18418__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_n_u32)))
18419svuint16_t svraddhnb_n_u32(svuint32_t, uint32_t);
18420__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_n_u64)))
18421svuint32_t svraddhnb_n_u64(svuint64_t, uint64_t);
18422__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_n_u16)))
18423svuint8_t svraddhnb_n_u16(svuint16_t, uint16_t);
18424__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_n_s32)))
18425svint16_t svraddhnb_n_s32(svint32_t, int32_t);
18426__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_n_s64)))
18427svint32_t svraddhnb_n_s64(svint64_t, int64_t);
18428__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_n_s16)))
18429svint8_t svraddhnb_n_s16(svint16_t, int16_t);
18430__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_u32)))
18431svuint16_t svraddhnb_u32(svuint32_t, svuint32_t);
18432__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_u64)))
18433svuint32_t svraddhnb_u64(svuint64_t, svuint64_t);
18434__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_u16)))
18435svuint8_t svraddhnb_u16(svuint16_t, svuint16_t);
18436__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_s32)))
18437svint16_t svraddhnb_s32(svint32_t, svint32_t);
18438__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_s64)))
18439svint32_t svraddhnb_s64(svint64_t, svint64_t);
18440__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_s16)))
18441svint8_t svraddhnb_s16(svint16_t, svint16_t);
18442__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_n_u32)))
18443svuint16_t svraddhnt_n_u32(svuint16_t, svuint32_t, uint32_t);
18444__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_n_u64)))
18445svuint32_t svraddhnt_n_u64(svuint32_t, svuint64_t, uint64_t);
18446__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_n_u16)))
18447svuint8_t svraddhnt_n_u16(svuint8_t, svuint16_t, uint16_t);
18448__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_n_s32)))
18449svint16_t svraddhnt_n_s32(svint16_t, svint32_t, int32_t);
18450__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_n_s64)))
18451svint32_t svraddhnt_n_s64(svint32_t, svint64_t, int64_t);
18452__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_n_s16)))
18453svint8_t svraddhnt_n_s16(svint8_t, svint16_t, int16_t);
18454__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_u32)))
18455svuint16_t svraddhnt_u32(svuint16_t, svuint32_t, svuint32_t);
18456__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_u64)))
18457svuint32_t svraddhnt_u64(svuint32_t, svuint64_t, svuint64_t);
18458__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_u16)))
18459svuint8_t svraddhnt_u16(svuint8_t, svuint16_t, svuint16_t);
18460__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_s32)))
18461svint16_t svraddhnt_s32(svint16_t, svint32_t, svint32_t);
18462__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_s64)))
18463svint32_t svraddhnt_s64(svint32_t, svint64_t, svint64_t);
18464__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_s16)))
18465svint8_t svraddhnt_s16(svint8_t, svint16_t, svint16_t);
18466__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrecpe_u32_m)))
18467svuint32_t svrecpe_u32_m(svuint32_t, svbool_t, svuint32_t);
18468__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrecpe_u32_x)))
18469svuint32_t svrecpe_u32_x(svbool_t, svuint32_t);
18470__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrecpe_u32_z)))
18471svuint32_t svrecpe_u32_z(svbool_t, svuint32_t);
18472__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s8_m)))
18473svint8_t svrhadd_n_s8_m(svbool_t, svint8_t, int8_t);
18474__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s32_m)))
18475svint32_t svrhadd_n_s32_m(svbool_t, svint32_t, int32_t);
18476__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s64_m)))
18477svint64_t svrhadd_n_s64_m(svbool_t, svint64_t, int64_t);
18478__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s16_m)))
18479svint16_t svrhadd_n_s16_m(svbool_t, svint16_t, int16_t);
18480__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s8_x)))
18481svint8_t svrhadd_n_s8_x(svbool_t, svint8_t, int8_t);
18482__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s32_x)))
18483svint32_t svrhadd_n_s32_x(svbool_t, svint32_t, int32_t);
18484__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s64_x)))
18485svint64_t svrhadd_n_s64_x(svbool_t, svint64_t, int64_t);
18486__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s16_x)))
18487svint16_t svrhadd_n_s16_x(svbool_t, svint16_t, int16_t);
18488__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s8_z)))
18489svint8_t svrhadd_n_s8_z(svbool_t, svint8_t, int8_t);
18490__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s32_z)))
18491svint32_t svrhadd_n_s32_z(svbool_t, svint32_t, int32_t);
18492__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s64_z)))
18493svint64_t svrhadd_n_s64_z(svbool_t, svint64_t, int64_t);
18494__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s16_z)))
18495svint16_t svrhadd_n_s16_z(svbool_t, svint16_t, int16_t);
18496__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u8_m)))
18497svuint8_t svrhadd_n_u8_m(svbool_t, svuint8_t, uint8_t);
18498__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u32_m)))
18499svuint32_t svrhadd_n_u32_m(svbool_t, svuint32_t, uint32_t);
18500__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u64_m)))
18501svuint64_t svrhadd_n_u64_m(svbool_t, svuint64_t, uint64_t);
18502__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u16_m)))
18503svuint16_t svrhadd_n_u16_m(svbool_t, svuint16_t, uint16_t);
18504__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u8_x)))
18505svuint8_t svrhadd_n_u8_x(svbool_t, svuint8_t, uint8_t);
18506__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u32_x)))
18507svuint32_t svrhadd_n_u32_x(svbool_t, svuint32_t, uint32_t);
18508__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u64_x)))
18509svuint64_t svrhadd_n_u64_x(svbool_t, svuint64_t, uint64_t);
18510__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u16_x)))
18511svuint16_t svrhadd_n_u16_x(svbool_t, svuint16_t, uint16_t);
18512__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u8_z)))
18513svuint8_t svrhadd_n_u8_z(svbool_t, svuint8_t, uint8_t);
18514__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u32_z)))
18515svuint32_t svrhadd_n_u32_z(svbool_t, svuint32_t, uint32_t);
18516__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u64_z)))
18517svuint64_t svrhadd_n_u64_z(svbool_t, svuint64_t, uint64_t);
18518__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u16_z)))
18519svuint16_t svrhadd_n_u16_z(svbool_t, svuint16_t, uint16_t);
18520__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s8_m)))
18521svint8_t svrhadd_s8_m(svbool_t, svint8_t, svint8_t);
18522__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s32_m)))
18523svint32_t svrhadd_s32_m(svbool_t, svint32_t, svint32_t);
18524__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s64_m)))
18525svint64_t svrhadd_s64_m(svbool_t, svint64_t, svint64_t);
18526__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s16_m)))
18527svint16_t svrhadd_s16_m(svbool_t, svint16_t, svint16_t);
18528__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s8_x)))
18529svint8_t svrhadd_s8_x(svbool_t, svint8_t, svint8_t);
18530__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s32_x)))
18531svint32_t svrhadd_s32_x(svbool_t, svint32_t, svint32_t);
18532__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s64_x)))
18533svint64_t svrhadd_s64_x(svbool_t, svint64_t, svint64_t);
18534__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s16_x)))
18535svint16_t svrhadd_s16_x(svbool_t, svint16_t, svint16_t);
18536__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s8_z)))
18537svint8_t svrhadd_s8_z(svbool_t, svint8_t, svint8_t);
18538__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s32_z)))
18539svint32_t svrhadd_s32_z(svbool_t, svint32_t, svint32_t);
18540__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s64_z)))
18541svint64_t svrhadd_s64_z(svbool_t, svint64_t, svint64_t);
18542__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s16_z)))
18543svint16_t svrhadd_s16_z(svbool_t, svint16_t, svint16_t);
18544__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u8_m)))
18545svuint8_t svrhadd_u8_m(svbool_t, svuint8_t, svuint8_t);
18546__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u32_m)))
18547svuint32_t svrhadd_u32_m(svbool_t, svuint32_t, svuint32_t);
18548__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u64_m)))
18549svuint64_t svrhadd_u64_m(svbool_t, svuint64_t, svuint64_t);
18550__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u16_m)))
18551svuint16_t svrhadd_u16_m(svbool_t, svuint16_t, svuint16_t);
18552__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u8_x)))
18553svuint8_t svrhadd_u8_x(svbool_t, svuint8_t, svuint8_t);
18554__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u32_x)))
18555svuint32_t svrhadd_u32_x(svbool_t, svuint32_t, svuint32_t);
18556__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u64_x)))
18557svuint64_t svrhadd_u64_x(svbool_t, svuint64_t, svuint64_t);
18558__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u16_x)))
18559svuint16_t svrhadd_u16_x(svbool_t, svuint16_t, svuint16_t);
18560__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u8_z)))
18561svuint8_t svrhadd_u8_z(svbool_t, svuint8_t, svuint8_t);
18562__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u32_z)))
18563svuint32_t svrhadd_u32_z(svbool_t, svuint32_t, svuint32_t);
18564__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u64_z)))
18565svuint64_t svrhadd_u64_z(svbool_t, svuint64_t, svuint64_t);
18566__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u16_z)))
18567svuint16_t svrhadd_u16_z(svbool_t, svuint16_t, svuint16_t);
18568__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s8_m)))
18569svint8_t svrshl_n_s8_m(svbool_t, svint8_t, int8_t);
18570__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s32_m)))
18571svint32_t svrshl_n_s32_m(svbool_t, svint32_t, int32_t);
18572__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s64_m)))
18573svint64_t svrshl_n_s64_m(svbool_t, svint64_t, int64_t);
18574__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s16_m)))
18575svint16_t svrshl_n_s16_m(svbool_t, svint16_t, int16_t);
18576__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s8_x)))
18577svint8_t svrshl_n_s8_x(svbool_t, svint8_t, int8_t);
18578__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s32_x)))
18579svint32_t svrshl_n_s32_x(svbool_t, svint32_t, int32_t);
18580__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s64_x)))
18581svint64_t svrshl_n_s64_x(svbool_t, svint64_t, int64_t);
18582__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s16_x)))
18583svint16_t svrshl_n_s16_x(svbool_t, svint16_t, int16_t);
18584__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s8_z)))
18585svint8_t svrshl_n_s8_z(svbool_t, svint8_t, int8_t);
18586__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s32_z)))
18587svint32_t svrshl_n_s32_z(svbool_t, svint32_t, int32_t);
18588__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s64_z)))
18589svint64_t svrshl_n_s64_z(svbool_t, svint64_t, int64_t);
18590__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s16_z)))
18591svint16_t svrshl_n_s16_z(svbool_t, svint16_t, int16_t);
18592__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u8_m)))
18593svuint8_t svrshl_n_u8_m(svbool_t, svuint8_t, int8_t);
18594__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u32_m)))
18595svuint32_t svrshl_n_u32_m(svbool_t, svuint32_t, int32_t);
18596__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u64_m)))
18597svuint64_t svrshl_n_u64_m(svbool_t, svuint64_t, int64_t);
18598__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u16_m)))
18599svuint16_t svrshl_n_u16_m(svbool_t, svuint16_t, int16_t);
18600__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u8_x)))
18601svuint8_t svrshl_n_u8_x(svbool_t, svuint8_t, int8_t);
18602__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u32_x)))
18603svuint32_t svrshl_n_u32_x(svbool_t, svuint32_t, int32_t);
18604__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u64_x)))
18605svuint64_t svrshl_n_u64_x(svbool_t, svuint64_t, int64_t);
18606__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u16_x)))
18607svuint16_t svrshl_n_u16_x(svbool_t, svuint16_t, int16_t);
18608__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u8_z)))
18609svuint8_t svrshl_n_u8_z(svbool_t, svuint8_t, int8_t);
18610__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u32_z)))
18611svuint32_t svrshl_n_u32_z(svbool_t, svuint32_t, int32_t);
18612__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u64_z)))
18613svuint64_t svrshl_n_u64_z(svbool_t, svuint64_t, int64_t);
18614__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u16_z)))
18615svuint16_t svrshl_n_u16_z(svbool_t, svuint16_t, int16_t);
18616__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s8_m)))
18617svint8_t svrshl_s8_m(svbool_t, svint8_t, svint8_t);
18618__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s32_m)))
18619svint32_t svrshl_s32_m(svbool_t, svint32_t, svint32_t);
18620__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s64_m)))
18621svint64_t svrshl_s64_m(svbool_t, svint64_t, svint64_t);
18622__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s16_m)))
18623svint16_t svrshl_s16_m(svbool_t, svint16_t, svint16_t);
18624__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s8_x)))
18625svint8_t svrshl_s8_x(svbool_t, svint8_t, svint8_t);
18626__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s32_x)))
18627svint32_t svrshl_s32_x(svbool_t, svint32_t, svint32_t);
18628__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s64_x)))
18629svint64_t svrshl_s64_x(svbool_t, svint64_t, svint64_t);
18630__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s16_x)))
18631svint16_t svrshl_s16_x(svbool_t, svint16_t, svint16_t);
18632__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s8_z)))
18633svint8_t svrshl_s8_z(svbool_t, svint8_t, svint8_t);
18634__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s32_z)))
18635svint32_t svrshl_s32_z(svbool_t, svint32_t, svint32_t);
18636__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s64_z)))
18637svint64_t svrshl_s64_z(svbool_t, svint64_t, svint64_t);
18638__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s16_z)))
18639svint16_t svrshl_s16_z(svbool_t, svint16_t, svint16_t);
18640__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u8_m)))
18641svuint8_t svrshl_u8_m(svbool_t, svuint8_t, svint8_t);
18642__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u32_m)))
18643svuint32_t svrshl_u32_m(svbool_t, svuint32_t, svint32_t);
18644__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u64_m)))
18645svuint64_t svrshl_u64_m(svbool_t, svuint64_t, svint64_t);
18646__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u16_m)))
18647svuint16_t svrshl_u16_m(svbool_t, svuint16_t, svint16_t);
18648__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u8_x)))
18649svuint8_t svrshl_u8_x(svbool_t, svuint8_t, svint8_t);
18650__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u32_x)))
18651svuint32_t svrshl_u32_x(svbool_t, svuint32_t, svint32_t);
18652__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u64_x)))
18653svuint64_t svrshl_u64_x(svbool_t, svuint64_t, svint64_t);
18654__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u16_x)))
18655svuint16_t svrshl_u16_x(svbool_t, svuint16_t, svint16_t);
18656__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u8_z)))
18657svuint8_t svrshl_u8_z(svbool_t, svuint8_t, svint8_t);
18658__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u32_z)))
18659svuint32_t svrshl_u32_z(svbool_t, svuint32_t, svint32_t);
18660__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u64_z)))
18661svuint64_t svrshl_u64_z(svbool_t, svuint64_t, svint64_t);
18662__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u16_z)))
18663svuint16_t svrshl_u16_z(svbool_t, svuint16_t, svint16_t);
18664__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s8_m)))
18665svint8_t svrshr_n_s8_m(svbool_t, svint8_t, uint64_t);
18666__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s32_m)))
18667svint32_t svrshr_n_s32_m(svbool_t, svint32_t, uint64_t);
18668__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s64_m)))
18669svint64_t svrshr_n_s64_m(svbool_t, svint64_t, uint64_t);
18670__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s16_m)))
18671svint16_t svrshr_n_s16_m(svbool_t, svint16_t, uint64_t);
18672__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u8_m)))
18673svuint8_t svrshr_n_u8_m(svbool_t, svuint8_t, uint64_t);
18674__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u32_m)))
18675svuint32_t svrshr_n_u32_m(svbool_t, svuint32_t, uint64_t);
18676__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u64_m)))
18677svuint64_t svrshr_n_u64_m(svbool_t, svuint64_t, uint64_t);
18678__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u16_m)))
18679svuint16_t svrshr_n_u16_m(svbool_t, svuint16_t, uint64_t);
18680__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s8_x)))
18681svint8_t svrshr_n_s8_x(svbool_t, svint8_t, uint64_t);
18682__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s32_x)))
18683svint32_t svrshr_n_s32_x(svbool_t, svint32_t, uint64_t);
18684__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s64_x)))
18685svint64_t svrshr_n_s64_x(svbool_t, svint64_t, uint64_t);
18686__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s16_x)))
18687svint16_t svrshr_n_s16_x(svbool_t, svint16_t, uint64_t);
18688__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u8_x)))
18689svuint8_t svrshr_n_u8_x(svbool_t, svuint8_t, uint64_t);
18690__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u32_x)))
18691svuint32_t svrshr_n_u32_x(svbool_t, svuint32_t, uint64_t);
18692__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u64_x)))
18693svuint64_t svrshr_n_u64_x(svbool_t, svuint64_t, uint64_t);
18694__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u16_x)))
18695svuint16_t svrshr_n_u16_x(svbool_t, svuint16_t, uint64_t);
18696__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s8_z)))
18697svint8_t svrshr_n_s8_z(svbool_t, svint8_t, uint64_t);
18698__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s32_z)))
18699svint32_t svrshr_n_s32_z(svbool_t, svint32_t, uint64_t);
18700__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s64_z)))
18701svint64_t svrshr_n_s64_z(svbool_t, svint64_t, uint64_t);
18702__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s16_z)))
18703svint16_t svrshr_n_s16_z(svbool_t, svint16_t, uint64_t);
18704__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u8_z)))
18705svuint8_t svrshr_n_u8_z(svbool_t, svuint8_t, uint64_t);
18706__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u32_z)))
18707svuint32_t svrshr_n_u32_z(svbool_t, svuint32_t, uint64_t);
18708__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u64_z)))
18709svuint64_t svrshr_n_u64_z(svbool_t, svuint64_t, uint64_t);
18710__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u16_z)))
18711svuint16_t svrshr_n_u16_z(svbool_t, svuint16_t, uint64_t);
18712__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnb_n_u32)))
18713svuint16_t svrshrnb_n_u32(svuint32_t, uint64_t);
18714__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnb_n_u64)))
18715svuint32_t svrshrnb_n_u64(svuint64_t, uint64_t);
18716__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnb_n_u16)))
18717svuint8_t svrshrnb_n_u16(svuint16_t, uint64_t);
18718__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnb_n_s32)))
18719svint16_t svrshrnb_n_s32(svint32_t, uint64_t);
18720__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnb_n_s64)))
18721svint32_t svrshrnb_n_s64(svint64_t, uint64_t);
18722__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnb_n_s16)))
18723svint8_t svrshrnb_n_s16(svint16_t, uint64_t);
18724__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnt_n_u32)))
18725svuint16_t svrshrnt_n_u32(svuint16_t, svuint32_t, uint64_t);
18726__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnt_n_u64)))
18727svuint32_t svrshrnt_n_u64(svuint32_t, svuint64_t, uint64_t);
18728__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnt_n_u16)))
18729svuint8_t svrshrnt_n_u16(svuint8_t, svuint16_t, uint64_t);
18730__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnt_n_s32)))
18731svint16_t svrshrnt_n_s32(svint16_t, svint32_t, uint64_t);
18732__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnt_n_s64)))
18733svint32_t svrshrnt_n_s64(svint32_t, svint64_t, uint64_t);
18734__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnt_n_s16)))
18735svint8_t svrshrnt_n_s16(svint8_t, svint16_t, uint64_t);
18736__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsqrte_u32_m)))
18737svuint32_t svrsqrte_u32_m(svuint32_t, svbool_t, svuint32_t);
18738__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsqrte_u32_x)))
18739svuint32_t svrsqrte_u32_x(svbool_t, svuint32_t);
18740__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsqrte_u32_z)))
18741svuint32_t svrsqrte_u32_z(svbool_t, svuint32_t);
18742__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_s8)))
18743svint8_t svrsra_n_s8(svint8_t, svint8_t, uint64_t);
18744__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_s32)))
18745svint32_t svrsra_n_s32(svint32_t, svint32_t, uint64_t);
18746__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_s64)))
18747svint64_t svrsra_n_s64(svint64_t, svint64_t, uint64_t);
18748__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_s16)))
18749svint16_t svrsra_n_s16(svint16_t, svint16_t, uint64_t);
18750__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_u8)))
18751svuint8_t svrsra_n_u8(svuint8_t, svuint8_t, uint64_t);
18752__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_u32)))
18753svuint32_t svrsra_n_u32(svuint32_t, svuint32_t, uint64_t);
18754__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_u64)))
18755svuint64_t svrsra_n_u64(svuint64_t, svuint64_t, uint64_t);
18756__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_u16)))
18757svuint16_t svrsra_n_u16(svuint16_t, svuint16_t, uint64_t);
18758__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_n_u32)))
18759svuint16_t svrsubhnb_n_u32(svuint32_t, uint32_t);
18760__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_n_u64)))
18761svuint32_t svrsubhnb_n_u64(svuint64_t, uint64_t);
18762__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_n_u16)))
18763svuint8_t svrsubhnb_n_u16(svuint16_t, uint16_t);
18764__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_n_s32)))
18765svint16_t svrsubhnb_n_s32(svint32_t, int32_t);
18766__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_n_s64)))
18767svint32_t svrsubhnb_n_s64(svint64_t, int64_t);
18768__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_n_s16)))
18769svint8_t svrsubhnb_n_s16(svint16_t, int16_t);
18770__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_u32)))
18771svuint16_t svrsubhnb_u32(svuint32_t, svuint32_t);
18772__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_u64)))
18773svuint32_t svrsubhnb_u64(svuint64_t, svuint64_t);
18774__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_u16)))
18775svuint8_t svrsubhnb_u16(svuint16_t, svuint16_t);
18776__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_s32)))
18777svint16_t svrsubhnb_s32(svint32_t, svint32_t);
18778__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_s64)))
18779svint32_t svrsubhnb_s64(svint64_t, svint64_t);
18780__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_s16)))
18781svint8_t svrsubhnb_s16(svint16_t, svint16_t);
18782__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_n_u32)))
18783svuint16_t svrsubhnt_n_u32(svuint16_t, svuint32_t, uint32_t);
18784__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_n_u64)))
18785svuint32_t svrsubhnt_n_u64(svuint32_t, svuint64_t, uint64_t);
18786__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_n_u16)))
18787svuint8_t svrsubhnt_n_u16(svuint8_t, svuint16_t, uint16_t);
18788__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_n_s32)))
18789svint16_t svrsubhnt_n_s32(svint16_t, svint32_t, int32_t);
18790__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_n_s64)))
18791svint32_t svrsubhnt_n_s64(svint32_t, svint64_t, int64_t);
18792__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_n_s16)))
18793svint8_t svrsubhnt_n_s16(svint8_t, svint16_t, int16_t);
18794__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_u32)))
18795svuint16_t svrsubhnt_u32(svuint16_t, svuint32_t, svuint32_t);
18796__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_u64)))
18797svuint32_t svrsubhnt_u64(svuint32_t, svuint64_t, svuint64_t);
18798__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_u16)))
18799svuint8_t svrsubhnt_u16(svuint8_t, svuint16_t, svuint16_t);
18800__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_s32)))
18801svint16_t svrsubhnt_s32(svint16_t, svint32_t, svint32_t);
18802__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_s64)))
18803svint32_t svrsubhnt_s64(svint32_t, svint64_t, svint64_t);
18804__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_s16)))
18805svint8_t svrsubhnt_s16(svint8_t, svint16_t, svint16_t);
18806__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclb_n_u32)))
18807svuint32_t svsbclb_n_u32(svuint32_t, svuint32_t, uint32_t);
18808__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclb_n_u64)))
18809svuint64_t svsbclb_n_u64(svuint64_t, svuint64_t, uint64_t);
18810__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclb_u32)))
18811svuint32_t svsbclb_u32(svuint32_t, svuint32_t, svuint32_t);
18812__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclb_u64)))
18813svuint64_t svsbclb_u64(svuint64_t, svuint64_t, svuint64_t);
18814__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclt_n_u32)))
18815svuint32_t svsbclt_n_u32(svuint32_t, svuint32_t, uint32_t);
18816__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclt_n_u64)))
18817svuint64_t svsbclt_n_u64(svuint64_t, svuint64_t, uint64_t);
18818__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclt_u32)))
18819svuint32_t svsbclt_u32(svuint32_t, svuint32_t, svuint32_t);
18820__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclt_u64)))
18821svuint64_t svsbclt_u64(svuint64_t, svuint64_t, svuint64_t);
18822__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllb_n_s32)))
18823svint32_t svshllb_n_s32(svint16_t, uint64_t);
18824__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllb_n_s64)))
18825svint64_t svshllb_n_s64(svint32_t, uint64_t);
18826__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllb_n_s16)))
18827svint16_t svshllb_n_s16(svint8_t, uint64_t);
18828__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllb_n_u32)))
18829svuint32_t svshllb_n_u32(svuint16_t, uint64_t);
18830__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllb_n_u64)))
18831svuint64_t svshllb_n_u64(svuint32_t, uint64_t);
18832__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllb_n_u16)))
18833svuint16_t svshllb_n_u16(svuint8_t, uint64_t);
18834__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllt_n_s32)))
18835svint32_t svshllt_n_s32(svint16_t, uint64_t);
18836__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllt_n_s64)))
18837svint64_t svshllt_n_s64(svint32_t, uint64_t);
18838__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllt_n_s16)))
18839svint16_t svshllt_n_s16(svint8_t, uint64_t);
18840__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllt_n_u32)))
18841svuint32_t svshllt_n_u32(svuint16_t, uint64_t);
18842__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllt_n_u64)))
18843svuint64_t svshllt_n_u64(svuint32_t, uint64_t);
18844__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllt_n_u16)))
18845svuint16_t svshllt_n_u16(svuint8_t, uint64_t);
18846__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnb_n_u32)))
18847svuint16_t svshrnb_n_u32(svuint32_t, uint64_t);
18848__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnb_n_u64)))
18849svuint32_t svshrnb_n_u64(svuint64_t, uint64_t);
18850__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnb_n_u16)))
18851svuint8_t svshrnb_n_u16(svuint16_t, uint64_t);
18852__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnb_n_s32)))
18853svint16_t svshrnb_n_s32(svint32_t, uint64_t);
18854__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnb_n_s64)))
18855svint32_t svshrnb_n_s64(svint64_t, uint64_t);
18856__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnb_n_s16)))
18857svint8_t svshrnb_n_s16(svint16_t, uint64_t);
18858__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnt_n_u32)))
18859svuint16_t svshrnt_n_u32(svuint16_t, svuint32_t, uint64_t);
18860__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnt_n_u64)))
18861svuint32_t svshrnt_n_u64(svuint32_t, svuint64_t, uint64_t);
18862__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnt_n_u16)))
18863svuint8_t svshrnt_n_u16(svuint8_t, svuint16_t, uint64_t);
18864__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnt_n_s32)))
18865svint16_t svshrnt_n_s32(svint16_t, svint32_t, uint64_t);
18866__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnt_n_s64)))
18867svint32_t svshrnt_n_s64(svint32_t, svint64_t, uint64_t);
18868__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnt_n_s16)))
18869svint8_t svshrnt_n_s16(svint8_t, svint16_t, uint64_t);
18870__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_u8)))
18871svuint8_t svsli_n_u8(svuint8_t, svuint8_t, uint64_t);
18872__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_u32)))
18873svuint32_t svsli_n_u32(svuint32_t, svuint32_t, uint64_t);
18874__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_u64)))
18875svuint64_t svsli_n_u64(svuint64_t, svuint64_t, uint64_t);
18876__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_u16)))
18877svuint16_t svsli_n_u16(svuint16_t, svuint16_t, uint64_t);
18878__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_s8)))
18879svint8_t svsli_n_s8(svint8_t, svint8_t, uint64_t);
18880__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_s32)))
18881svint32_t svsli_n_s32(svint32_t, svint32_t, uint64_t);
18882__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_s64)))
18883svint64_t svsli_n_s64(svint64_t, svint64_t, uint64_t);
18884__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_s16)))
18885svint16_t svsli_n_s16(svint16_t, svint16_t, uint64_t);
18886__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u8_m)))
18887svuint8_t svsqadd_n_u8_m(svbool_t, svuint8_t, int8_t);
18888__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u32_m)))
18889svuint32_t svsqadd_n_u32_m(svbool_t, svuint32_t, int32_t);
18890__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u64_m)))
18891svuint64_t svsqadd_n_u64_m(svbool_t, svuint64_t, int64_t);
18892__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u16_m)))
18893svuint16_t svsqadd_n_u16_m(svbool_t, svuint16_t, int16_t);
18894__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u8_x)))
18895svuint8_t svsqadd_n_u8_x(svbool_t, svuint8_t, int8_t);
18896__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u32_x)))
18897svuint32_t svsqadd_n_u32_x(svbool_t, svuint32_t, int32_t);
18898__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u64_x)))
18899svuint64_t svsqadd_n_u64_x(svbool_t, svuint64_t, int64_t);
18900__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u16_x)))
18901svuint16_t svsqadd_n_u16_x(svbool_t, svuint16_t, int16_t);
18902__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u8_z)))
18903svuint8_t svsqadd_n_u8_z(svbool_t, svuint8_t, int8_t);
18904__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u32_z)))
18905svuint32_t svsqadd_n_u32_z(svbool_t, svuint32_t, int32_t);
18906__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u64_z)))
18907svuint64_t svsqadd_n_u64_z(svbool_t, svuint64_t, int64_t);
18908__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u16_z)))
18909svuint16_t svsqadd_n_u16_z(svbool_t, svuint16_t, int16_t);
18910__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u8_m)))
18911svuint8_t svsqadd_u8_m(svbool_t, svuint8_t, svint8_t);
18912__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u32_m)))
18913svuint32_t svsqadd_u32_m(svbool_t, svuint32_t, svint32_t);
18914__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u64_m)))
18915svuint64_t svsqadd_u64_m(svbool_t, svuint64_t, svint64_t);
18916__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u16_m)))
18917svuint16_t svsqadd_u16_m(svbool_t, svuint16_t, svint16_t);
18918__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u8_x)))
18919svuint8_t svsqadd_u8_x(svbool_t, svuint8_t, svint8_t);
18920__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u32_x)))
18921svuint32_t svsqadd_u32_x(svbool_t, svuint32_t, svint32_t);
18922__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u64_x)))
18923svuint64_t svsqadd_u64_x(svbool_t, svuint64_t, svint64_t);
18924__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u16_x)))
18925svuint16_t svsqadd_u16_x(svbool_t, svuint16_t, svint16_t);
18926__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u8_z)))
18927svuint8_t svsqadd_u8_z(svbool_t, svuint8_t, svint8_t);
18928__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u32_z)))
18929svuint32_t svsqadd_u32_z(svbool_t, svuint32_t, svint32_t);
18930__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u64_z)))
18931svuint64_t svsqadd_u64_z(svbool_t, svuint64_t, svint64_t);
18932__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u16_z)))
18933svuint16_t svsqadd_u16_z(svbool_t, svuint16_t, svint16_t);
18934__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_s8)))
18935svint8_t svsra_n_s8(svint8_t, svint8_t, uint64_t);
18936__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_s32)))
18937svint32_t svsra_n_s32(svint32_t, svint32_t, uint64_t);
18938__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_s64)))
18939svint64_t svsra_n_s64(svint64_t, svint64_t, uint64_t);
18940__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_s16)))
18941svint16_t svsra_n_s16(svint16_t, svint16_t, uint64_t);
18942__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_u8)))
18943svuint8_t svsra_n_u8(svuint8_t, svuint8_t, uint64_t);
18944__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_u32)))
18945svuint32_t svsra_n_u32(svuint32_t, svuint32_t, uint64_t);
18946__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_u64)))
18947svuint64_t svsra_n_u64(svuint64_t, svuint64_t, uint64_t);
18948__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_u16)))
18949svuint16_t svsra_n_u16(svuint16_t, svuint16_t, uint64_t);
18950__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_u8)))
18951svuint8_t svsri_n_u8(svuint8_t, svuint8_t, uint64_t);
18952__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_u32)))
18953svuint32_t svsri_n_u32(svuint32_t, svuint32_t, uint64_t);
18954__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_u64)))
18955svuint64_t svsri_n_u64(svuint64_t, svuint64_t, uint64_t);
18956__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_u16)))
18957svuint16_t svsri_n_u16(svuint16_t, svuint16_t, uint64_t);
18958__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_s8)))
18959svint8_t svsri_n_s8(svint8_t, svint8_t, uint64_t);
18960__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_s32)))
18961svint32_t svsri_n_s32(svint32_t, svint32_t, uint64_t);
18962__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_s64)))
18963svint64_t svsri_n_s64(svint64_t, svint64_t, uint64_t);
18964__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_s16)))
18965svint16_t svsri_n_s16(svint16_t, svint16_t, uint64_t);
18966__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_index_u32)))
18967void svstnt1_scatter_u32base_index_u32(svbool_t, svuint32_t, int64_t, svuint32_t);
18968__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_index_u64)))
18969void svstnt1_scatter_u64base_index_u64(svbool_t, svuint64_t, int64_t, svuint64_t);
18970__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_index_f64)))
18971void svstnt1_scatter_u64base_index_f64(svbool_t, svuint64_t, int64_t, svfloat64_t);
18972__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_index_f32)))
18973void svstnt1_scatter_u32base_index_f32(svbool_t, svuint32_t, int64_t, svfloat32_t);
18974__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_index_s32)))
18975void svstnt1_scatter_u32base_index_s32(svbool_t, svuint32_t, int64_t, svint32_t);
18976__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_index_s64)))
18977void svstnt1_scatter_u64base_index_s64(svbool_t, svuint64_t, int64_t, svint64_t);
18978__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_offset_u32)))
18979void svstnt1_scatter_u32base_offset_u32(svbool_t, svuint32_t, int64_t, svuint32_t);
18980__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_offset_u64)))
18981void svstnt1_scatter_u64base_offset_u64(svbool_t, svuint64_t, int64_t, svuint64_t);
18982__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_offset_f64)))
18983void svstnt1_scatter_u64base_offset_f64(svbool_t, svuint64_t, int64_t, svfloat64_t);
18984__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_offset_f32)))
18985void svstnt1_scatter_u32base_offset_f32(svbool_t, svuint32_t, int64_t, svfloat32_t);
18986__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_offset_s32)))
18987void svstnt1_scatter_u32base_offset_s32(svbool_t, svuint32_t, int64_t, svint32_t);
18988__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_offset_s64)))
18989void svstnt1_scatter_u64base_offset_s64(svbool_t, svuint64_t, int64_t, svint64_t);
18990__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_u32)))
18991void svstnt1_scatter_u32base_u32(svbool_t, svuint32_t, svuint32_t);
18992__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_u64)))
18993void svstnt1_scatter_u64base_u64(svbool_t, svuint64_t, svuint64_t);
18994__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_f64)))
18995void svstnt1_scatter_u64base_f64(svbool_t, svuint64_t, svfloat64_t);
18996__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_f32)))
18997void svstnt1_scatter_u32base_f32(svbool_t, svuint32_t, svfloat32_t);
18998__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_s32)))
18999void svstnt1_scatter_u32base_s32(svbool_t, svuint32_t, svint32_t);
19000__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_s64)))
19001void svstnt1_scatter_u64base_s64(svbool_t, svuint64_t, svint64_t);
19002__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_s64index_u64)))
19003void svstnt1_scatter_s64index_u64(svbool_t, uint64_t *, svint64_t, svuint64_t);
19004__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_s64index_f64)))
19005void svstnt1_scatter_s64index_f64(svbool_t, float64_t *, svint64_t, svfloat64_t);
19006__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_s64index_s64)))
19007void svstnt1_scatter_s64index_s64(svbool_t, int64_t *, svint64_t, svint64_t);
19008__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64index_u64)))
19009void svstnt1_scatter_u64index_u64(svbool_t, uint64_t *, svuint64_t, svuint64_t);
19010__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64index_f64)))
19011void svstnt1_scatter_u64index_f64(svbool_t, float64_t *, svuint64_t, svfloat64_t);
19012__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64index_s64)))
19013void svstnt1_scatter_u64index_s64(svbool_t, int64_t *, svuint64_t, svint64_t);
19014__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32offset_u32)))
19015void svstnt1_scatter_u32offset_u32(svbool_t, uint32_t *, svuint32_t, svuint32_t);
19016__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32offset_f32)))
19017void svstnt1_scatter_u32offset_f32(svbool_t, float32_t *, svuint32_t, svfloat32_t);
19018__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32offset_s32)))
19019void svstnt1_scatter_u32offset_s32(svbool_t, int32_t *, svuint32_t, svint32_t);
19020__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_s64offset_u64)))
19021void svstnt1_scatter_s64offset_u64(svbool_t, uint64_t *, svint64_t, svuint64_t);
19022__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_s64offset_f64)))
19023void svstnt1_scatter_s64offset_f64(svbool_t, float64_t *, svint64_t, svfloat64_t);
19024__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_s64offset_s64)))
19025void svstnt1_scatter_s64offset_s64(svbool_t, int64_t *, svint64_t, svint64_t);
19026__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64offset_u64)))
19027void svstnt1_scatter_u64offset_u64(svbool_t, uint64_t *, svuint64_t, svuint64_t);
19028__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64offset_f64)))
19029void svstnt1_scatter_u64offset_f64(svbool_t, float64_t *, svuint64_t, svfloat64_t);
19030__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64offset_s64)))
19031void svstnt1_scatter_u64offset_s64(svbool_t, int64_t *, svuint64_t, svint64_t);
19032__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u32base_offset_u32)))
19033void svstnt1b_scatter_u32base_offset_u32(svbool_t, svuint32_t, int64_t, svuint32_t);
19034__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u64base_offset_u64)))
19035void svstnt1b_scatter_u64base_offset_u64(svbool_t, svuint64_t, int64_t, svuint64_t);
19036__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u32base_offset_s32)))
19037void svstnt1b_scatter_u32base_offset_s32(svbool_t, svuint32_t, int64_t, svint32_t);
19038__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u64base_offset_s64)))
19039void svstnt1b_scatter_u64base_offset_s64(svbool_t, svuint64_t, int64_t, svint64_t);
19040__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u32base_u32)))
19041void svstnt1b_scatter_u32base_u32(svbool_t, svuint32_t, svuint32_t);
19042__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u64base_u64)))
19043void svstnt1b_scatter_u64base_u64(svbool_t, svuint64_t, svuint64_t);
19044__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u32base_s32)))
19045void svstnt1b_scatter_u32base_s32(svbool_t, svuint32_t, svint32_t);
19046__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u64base_s64)))
19047void svstnt1b_scatter_u64base_s64(svbool_t, svuint64_t, svint64_t);
19048__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u32offset_s32)))
19049void svstnt1b_scatter_u32offset_s32(svbool_t, int8_t *, svuint32_t, svint32_t);
19050__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u32offset_u32)))
19051void svstnt1b_scatter_u32offset_u32(svbool_t, uint8_t *, svuint32_t, svuint32_t);
19052__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_s64offset_s64)))
19053void svstnt1b_scatter_s64offset_s64(svbool_t, int8_t *, svint64_t, svint64_t);
19054__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_s64offset_u64)))
19055void svstnt1b_scatter_s64offset_u64(svbool_t, uint8_t *, svint64_t, svuint64_t);
19056__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u64offset_s64)))
19057void svstnt1b_scatter_u64offset_s64(svbool_t, int8_t *, svuint64_t, svint64_t);
19058__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u64offset_u64)))
19059void svstnt1b_scatter_u64offset_u64(svbool_t, uint8_t *, svuint64_t, svuint64_t);
19060__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32base_index_u32)))
19061void svstnt1h_scatter_u32base_index_u32(svbool_t, svuint32_t, int64_t, svuint32_t);
19062__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64base_index_u64)))
19063void svstnt1h_scatter_u64base_index_u64(svbool_t, svuint64_t, int64_t, svuint64_t);
19064__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32base_index_s32)))
19065void svstnt1h_scatter_u32base_index_s32(svbool_t, svuint32_t, int64_t, svint32_t);
19066__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64base_index_s64)))
19067void svstnt1h_scatter_u64base_index_s64(svbool_t, svuint64_t, int64_t, svint64_t);
19068__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32base_offset_u32)))
19069void svstnt1h_scatter_u32base_offset_u32(svbool_t, svuint32_t, int64_t, svuint32_t);
19070__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64base_offset_u64)))
19071void svstnt1h_scatter_u64base_offset_u64(svbool_t, svuint64_t, int64_t, svuint64_t);
19072__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32base_offset_s32)))
19073void svstnt1h_scatter_u32base_offset_s32(svbool_t, svuint32_t, int64_t, svint32_t);
19074__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64base_offset_s64)))
19075void svstnt1h_scatter_u64base_offset_s64(svbool_t, svuint64_t, int64_t, svint64_t);
19076__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32base_u32)))
19077void svstnt1h_scatter_u32base_u32(svbool_t, svuint32_t, svuint32_t);
19078__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64base_u64)))
19079void svstnt1h_scatter_u64base_u64(svbool_t, svuint64_t, svuint64_t);
19080__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32base_s32)))
19081void svstnt1h_scatter_u32base_s32(svbool_t, svuint32_t, svint32_t);
19082__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64base_s64)))
19083void svstnt1h_scatter_u64base_s64(svbool_t, svuint64_t, svint64_t);
19084__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_s64index_s64)))
19085void svstnt1h_scatter_s64index_s64(svbool_t, int16_t *, svint64_t, svint64_t);
19086__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_s64index_u64)))
19087void svstnt1h_scatter_s64index_u64(svbool_t, uint16_t *, svint64_t, svuint64_t);
19088__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64index_s64)))
19089void svstnt1h_scatter_u64index_s64(svbool_t, int16_t *, svuint64_t, svint64_t);
19090__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64index_u64)))
19091void svstnt1h_scatter_u64index_u64(svbool_t, uint16_t *, svuint64_t, svuint64_t);
19092__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32offset_s32)))
19093void svstnt1h_scatter_u32offset_s32(svbool_t, int16_t *, svuint32_t, svint32_t);
19094__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32offset_u32)))
19095void svstnt1h_scatter_u32offset_u32(svbool_t, uint16_t *, svuint32_t, svuint32_t);
19096__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_s64offset_s64)))
19097void svstnt1h_scatter_s64offset_s64(svbool_t, int16_t *, svint64_t, svint64_t);
19098__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_s64offset_u64)))
19099void svstnt1h_scatter_s64offset_u64(svbool_t, uint16_t *, svint64_t, svuint64_t);
19100__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64offset_s64)))
19101void svstnt1h_scatter_u64offset_s64(svbool_t, int16_t *, svuint64_t, svint64_t);
19102__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64offset_u64)))
19103void svstnt1h_scatter_u64offset_u64(svbool_t, uint16_t *, svuint64_t, svuint64_t);
19104__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64base_index_u64)))
19105void svstnt1w_scatter_u64base_index_u64(svbool_t, svuint64_t, int64_t, svuint64_t);
19106__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64base_index_s64)))
19107void svstnt1w_scatter_u64base_index_s64(svbool_t, svuint64_t, int64_t, svint64_t);
19108__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64base_offset_u64)))
19109void svstnt1w_scatter_u64base_offset_u64(svbool_t, svuint64_t, int64_t, svuint64_t);
19110__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64base_offset_s64)))
19111void svstnt1w_scatter_u64base_offset_s64(svbool_t, svuint64_t, int64_t, svint64_t);
19112__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64base_u64)))
19113void svstnt1w_scatter_u64base_u64(svbool_t, svuint64_t, svuint64_t);
19114__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64base_s64)))
19115void svstnt1w_scatter_u64base_s64(svbool_t, svuint64_t, svint64_t);
19116__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_s64index_s64)))
19117void svstnt1w_scatter_s64index_s64(svbool_t, int32_t *, svint64_t, svint64_t);
19118__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_s64index_u64)))
19119void svstnt1w_scatter_s64index_u64(svbool_t, uint32_t *, svint64_t, svuint64_t);
19120__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64index_s64)))
19121void svstnt1w_scatter_u64index_s64(svbool_t, int32_t *, svuint64_t, svint64_t);
19122__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64index_u64)))
19123void svstnt1w_scatter_u64index_u64(svbool_t, uint32_t *, svuint64_t, svuint64_t);
19124__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_s64offset_s64)))
19125void svstnt1w_scatter_s64offset_s64(svbool_t, int32_t *, svint64_t, svint64_t);
19126__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_s64offset_u64)))
19127void svstnt1w_scatter_s64offset_u64(svbool_t, uint32_t *, svint64_t, svuint64_t);
19128__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64offset_s64)))
19129void svstnt1w_scatter_u64offset_s64(svbool_t, int32_t *, svuint64_t, svint64_t);
19130__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64offset_u64)))
19131void svstnt1w_scatter_u64offset_u64(svbool_t, uint32_t *, svuint64_t, svuint64_t);
19132__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_n_u32)))
19133svuint16_t svsubhnb_n_u32(svuint32_t, uint32_t);
19134__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_n_u64)))
19135svuint32_t svsubhnb_n_u64(svuint64_t, uint64_t);
19136__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_n_u16)))
19137svuint8_t svsubhnb_n_u16(svuint16_t, uint16_t);
19138__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_n_s32)))
19139svint16_t svsubhnb_n_s32(svint32_t, int32_t);
19140__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_n_s64)))
19141svint32_t svsubhnb_n_s64(svint64_t, int64_t);
19142__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_n_s16)))
19143svint8_t svsubhnb_n_s16(svint16_t, int16_t);
19144__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_u32)))
19145svuint16_t svsubhnb_u32(svuint32_t, svuint32_t);
19146__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_u64)))
19147svuint32_t svsubhnb_u64(svuint64_t, svuint64_t);
19148__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_u16)))
19149svuint8_t svsubhnb_u16(svuint16_t, svuint16_t);
19150__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_s32)))
19151svint16_t svsubhnb_s32(svint32_t, svint32_t);
19152__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_s64)))
19153svint32_t svsubhnb_s64(svint64_t, svint64_t);
19154__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_s16)))
19155svint8_t svsubhnb_s16(svint16_t, svint16_t);
19156__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_n_u32)))
19157svuint16_t svsubhnt_n_u32(svuint16_t, svuint32_t, uint32_t);
19158__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_n_u64)))
19159svuint32_t svsubhnt_n_u64(svuint32_t, svuint64_t, uint64_t);
19160__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_n_u16)))
19161svuint8_t svsubhnt_n_u16(svuint8_t, svuint16_t, uint16_t);
19162__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_n_s32)))
19163svint16_t svsubhnt_n_s32(svint16_t, svint32_t, int32_t);
19164__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_n_s64)))
19165svint32_t svsubhnt_n_s64(svint32_t, svint64_t, int64_t);
19166__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_n_s16)))
19167svint8_t svsubhnt_n_s16(svint8_t, svint16_t, int16_t);
19168__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_u32)))
19169svuint16_t svsubhnt_u32(svuint16_t, svuint32_t, svuint32_t);
19170__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_u64)))
19171svuint32_t svsubhnt_u64(svuint32_t, svuint64_t, svuint64_t);
19172__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_u16)))
19173svuint8_t svsubhnt_u16(svuint8_t, svuint16_t, svuint16_t);
19174__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_s32)))
19175svint16_t svsubhnt_s32(svint16_t, svint32_t, svint32_t);
19176__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_s64)))
19177svint32_t svsubhnt_s64(svint32_t, svint64_t, svint64_t);
19178__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_s16)))
19179svint8_t svsubhnt_s16(svint8_t, svint16_t, svint16_t);
19180__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_n_s32)))
19181svint32_t svsublb_n_s32(svint16_t, int16_t);
19182__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_n_s64)))
19183svint64_t svsublb_n_s64(svint32_t, int32_t);
19184__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_n_s16)))
19185svint16_t svsublb_n_s16(svint8_t, int8_t);
19186__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_n_u32)))
19187svuint32_t svsublb_n_u32(svuint16_t, uint16_t);
19188__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_n_u64)))
19189svuint64_t svsublb_n_u64(svuint32_t, uint32_t);
19190__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_n_u16)))
19191svuint16_t svsublb_n_u16(svuint8_t, uint8_t);
19192__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_s32)))
19193svint32_t svsublb_s32(svint16_t, svint16_t);
19194__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_s64)))
19195svint64_t svsublb_s64(svint32_t, svint32_t);
19196__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_s16)))
19197svint16_t svsublb_s16(svint8_t, svint8_t);
19198__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_u32)))
19199svuint32_t svsublb_u32(svuint16_t, svuint16_t);
19200__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_u64)))
19201svuint64_t svsublb_u64(svuint32_t, svuint32_t);
19202__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_u16)))
19203svuint16_t svsublb_u16(svuint8_t, svuint8_t);
19204__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublbt_n_s32)))
19205svint32_t svsublbt_n_s32(svint16_t, int16_t);
19206__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublbt_n_s64)))
19207svint64_t svsublbt_n_s64(svint32_t, int32_t);
19208__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublbt_n_s16)))
19209svint16_t svsublbt_n_s16(svint8_t, int8_t);
19210__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublbt_s32)))
19211svint32_t svsublbt_s32(svint16_t, svint16_t);
19212__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublbt_s64)))
19213svint64_t svsublbt_s64(svint32_t, svint32_t);
19214__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublbt_s16)))
19215svint16_t svsublbt_s16(svint8_t, svint8_t);
19216__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_n_s32)))
19217svint32_t svsublt_n_s32(svint16_t, int16_t);
19218__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_n_s64)))
19219svint64_t svsublt_n_s64(svint32_t, int32_t);
19220__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_n_s16)))
19221svint16_t svsublt_n_s16(svint8_t, int8_t);
19222__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_n_u32)))
19223svuint32_t svsublt_n_u32(svuint16_t, uint16_t);
19224__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_n_u64)))
19225svuint64_t svsublt_n_u64(svuint32_t, uint32_t);
19226__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_n_u16)))
19227svuint16_t svsublt_n_u16(svuint8_t, uint8_t);
19228__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_s32)))
19229svint32_t svsublt_s32(svint16_t, svint16_t);
19230__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_s64)))
19231svint64_t svsublt_s64(svint32_t, svint32_t);
19232__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_s16)))
19233svint16_t svsublt_s16(svint8_t, svint8_t);
19234__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_u32)))
19235svuint32_t svsublt_u32(svuint16_t, svuint16_t);
19236__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_u64)))
19237svuint64_t svsublt_u64(svuint32_t, svuint32_t);
19238__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_u16)))
19239svuint16_t svsublt_u16(svuint8_t, svuint8_t);
19240__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubltb_n_s32)))
19241svint32_t svsubltb_n_s32(svint16_t, int16_t);
19242__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubltb_n_s64)))
19243svint64_t svsubltb_n_s64(svint32_t, int32_t);
19244__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubltb_n_s16)))
19245svint16_t svsubltb_n_s16(svint8_t, int8_t);
19246__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubltb_s32)))
19247svint32_t svsubltb_s32(svint16_t, svint16_t);
19248__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubltb_s64)))
19249svint64_t svsubltb_s64(svint32_t, svint32_t);
19250__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubltb_s16)))
19251svint16_t svsubltb_s16(svint8_t, svint8_t);
19252__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_n_s32)))
19253svint32_t svsubwb_n_s32(svint32_t, int16_t);
19254__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_n_s64)))
19255svint64_t svsubwb_n_s64(svint64_t, int32_t);
19256__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_n_s16)))
19257svint16_t svsubwb_n_s16(svint16_t, int8_t);
19258__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_n_u32)))
19259svuint32_t svsubwb_n_u32(svuint32_t, uint16_t);
19260__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_n_u64)))
19261svuint64_t svsubwb_n_u64(svuint64_t, uint32_t);
19262__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_n_u16)))
19263svuint16_t svsubwb_n_u16(svuint16_t, uint8_t);
19264__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_s32)))
19265svint32_t svsubwb_s32(svint32_t, svint16_t);
19266__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_s64)))
19267svint64_t svsubwb_s64(svint64_t, svint32_t);
19268__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_s16)))
19269svint16_t svsubwb_s16(svint16_t, svint8_t);
19270__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_u32)))
19271svuint32_t svsubwb_u32(svuint32_t, svuint16_t);
19272__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_u64)))
19273svuint64_t svsubwb_u64(svuint64_t, svuint32_t);
19274__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_u16)))
19275svuint16_t svsubwb_u16(svuint16_t, svuint8_t);
19276__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_n_s32)))
19277svint32_t svsubwt_n_s32(svint32_t, int16_t);
19278__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_n_s64)))
19279svint64_t svsubwt_n_s64(svint64_t, int32_t);
19280__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_n_s16)))
19281svint16_t svsubwt_n_s16(svint16_t, int8_t);
19282__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_n_u32)))
19283svuint32_t svsubwt_n_u32(svuint32_t, uint16_t);
19284__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_n_u64)))
19285svuint64_t svsubwt_n_u64(svuint64_t, uint32_t);
19286__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_n_u16)))
19287svuint16_t svsubwt_n_u16(svuint16_t, uint8_t);
19288__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_s32)))
19289svint32_t svsubwt_s32(svint32_t, svint16_t);
19290__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_s64)))
19291svint64_t svsubwt_s64(svint64_t, svint32_t);
19292__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_s16)))
19293svint16_t svsubwt_s16(svint16_t, svint8_t);
19294__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_u32)))
19295svuint32_t svsubwt_u32(svuint32_t, svuint16_t);
19296__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_u64)))
19297svuint64_t svsubwt_u64(svuint64_t, svuint32_t);
19298__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_u16)))
19299svuint16_t svsubwt_u16(svuint16_t, svuint8_t);
19300__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_u8)))
19301svuint8_t svtbl2_u8(svuint8x2_t, svuint8_t);
19302__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_u32)))
19303svuint32_t svtbl2_u32(svuint32x2_t, svuint32_t);
19304__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_u64)))
19305svuint64_t svtbl2_u64(svuint64x2_t, svuint64_t);
19306__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_u16)))
19307svuint16_t svtbl2_u16(svuint16x2_t, svuint16_t);
19308__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_s8)))
19309svint8_t svtbl2_s8(svint8x2_t, svuint8_t);
19310__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_f64)))
19311svfloat64_t svtbl2_f64(svfloat64x2_t, svuint64_t);
19312__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_f32)))
19313svfloat32_t svtbl2_f32(svfloat32x2_t, svuint32_t);
19314__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_f16)))
19315svfloat16_t svtbl2_f16(svfloat16x2_t, svuint16_t);
19316__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_s32)))
19317svint32_t svtbl2_s32(svint32x2_t, svuint32_t);
19318__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_s64)))
19319svint64_t svtbl2_s64(svint64x2_t, svuint64_t);
19320__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_s16)))
19321svint16_t svtbl2_s16(svint16x2_t, svuint16_t);
19322__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_u8)))
19323svuint8_t svtbx_u8(svuint8_t, svuint8_t, svuint8_t);
19324__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_u32)))
19325svuint32_t svtbx_u32(svuint32_t, svuint32_t, svuint32_t);
19326__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_u64)))
19327svuint64_t svtbx_u64(svuint64_t, svuint64_t, svuint64_t);
19328__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_u16)))
19329svuint16_t svtbx_u16(svuint16_t, svuint16_t, svuint16_t);
19330__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_s8)))
19331svint8_t svtbx_s8(svint8_t, svint8_t, svuint8_t);
19332__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_f64)))
19333svfloat64_t svtbx_f64(svfloat64_t, svfloat64_t, svuint64_t);
19334__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_f32)))
19335svfloat32_t svtbx_f32(svfloat32_t, svfloat32_t, svuint32_t);
19336__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_f16)))
19337svfloat16_t svtbx_f16(svfloat16_t, svfloat16_t, svuint16_t);
19338__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_s32)))
19339svint32_t svtbx_s32(svint32_t, svint32_t, svuint32_t);
19340__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_s64)))
19341svint64_t svtbx_s64(svint64_t, svint64_t, svuint64_t);
19342__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_s16)))
19343svint16_t svtbx_s16(svint16_t, svint16_t, svuint16_t);
19344__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s8_m)))
19345svint8_t svuqadd_n_s8_m(svbool_t, svint8_t, uint8_t);
19346__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s32_m)))
19347svint32_t svuqadd_n_s32_m(svbool_t, svint32_t, uint32_t);
19348__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s64_m)))
19349svint64_t svuqadd_n_s64_m(svbool_t, svint64_t, uint64_t);
19350__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s16_m)))
19351svint16_t svuqadd_n_s16_m(svbool_t, svint16_t, uint16_t);
19352__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s8_x)))
19353svint8_t svuqadd_n_s8_x(svbool_t, svint8_t, uint8_t);
19354__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s32_x)))
19355svint32_t svuqadd_n_s32_x(svbool_t, svint32_t, uint32_t);
19356__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s64_x)))
19357svint64_t svuqadd_n_s64_x(svbool_t, svint64_t, uint64_t);
19358__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s16_x)))
19359svint16_t svuqadd_n_s16_x(svbool_t, svint16_t, uint16_t);
19360__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s8_z)))
19361svint8_t svuqadd_n_s8_z(svbool_t, svint8_t, uint8_t);
19362__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s32_z)))
19363svint32_t svuqadd_n_s32_z(svbool_t, svint32_t, uint32_t);
19364__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s64_z)))
19365svint64_t svuqadd_n_s64_z(svbool_t, svint64_t, uint64_t);
19366__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s16_z)))
19367svint16_t svuqadd_n_s16_z(svbool_t, svint16_t, uint16_t);
19368__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s8_m)))
19369svint8_t svuqadd_s8_m(svbool_t, svint8_t, svuint8_t);
19370__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s32_m)))
19371svint32_t svuqadd_s32_m(svbool_t, svint32_t, svuint32_t);
19372__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s64_m)))
19373svint64_t svuqadd_s64_m(svbool_t, svint64_t, svuint64_t);
19374__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s16_m)))
19375svint16_t svuqadd_s16_m(svbool_t, svint16_t, svuint16_t);
19376__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s8_x)))
19377svint8_t svuqadd_s8_x(svbool_t, svint8_t, svuint8_t);
19378__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s32_x)))
19379svint32_t svuqadd_s32_x(svbool_t, svint32_t, svuint32_t);
19380__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s64_x)))
19381svint64_t svuqadd_s64_x(svbool_t, svint64_t, svuint64_t);
19382__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s16_x)))
19383svint16_t svuqadd_s16_x(svbool_t, svint16_t, svuint16_t);
19384__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s8_z)))
19385svint8_t svuqadd_s8_z(svbool_t, svint8_t, svuint8_t);
19386__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s32_z)))
19387svint32_t svuqadd_s32_z(svbool_t, svint32_t, svuint32_t);
19388__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s64_z)))
19389svint64_t svuqadd_s64_z(svbool_t, svint64_t, svuint64_t);
19390__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s16_z)))
19391svint16_t svuqadd_s16_z(svbool_t, svint16_t, svuint16_t);
19392__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b8_s32)))
19393svbool_t svwhilege_b8_s32(int32_t, int32_t);
19394__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b32_s32)))
19395svbool_t svwhilege_b32_s32(int32_t, int32_t);
19396__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b64_s32)))
19397svbool_t svwhilege_b64_s32(int32_t, int32_t);
19398__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b16_s32)))
19399svbool_t svwhilege_b16_s32(int32_t, int32_t);
19400__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b8_s64)))
19401svbool_t svwhilege_b8_s64(int64_t, int64_t);
19402__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b32_s64)))
19403svbool_t svwhilege_b32_s64(int64_t, int64_t);
19404__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b64_s64)))
19405svbool_t svwhilege_b64_s64(int64_t, int64_t);
19406__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b16_s64)))
19407svbool_t svwhilege_b16_s64(int64_t, int64_t);
19408__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b8_u32)))
19409svbool_t svwhilege_b8_u32(uint32_t, uint32_t);
19410__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b32_u32)))
19411svbool_t svwhilege_b32_u32(uint32_t, uint32_t);
19412__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b64_u32)))
19413svbool_t svwhilege_b64_u32(uint32_t, uint32_t);
19414__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b16_u32)))
19415svbool_t svwhilege_b16_u32(uint32_t, uint32_t);
19416__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b8_u64)))
19417svbool_t svwhilege_b8_u64(uint64_t, uint64_t);
19418__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b32_u64)))
19419svbool_t svwhilege_b32_u64(uint64_t, uint64_t);
19420__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b64_u64)))
19421svbool_t svwhilege_b64_u64(uint64_t, uint64_t);
19422__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b16_u64)))
19423svbool_t svwhilege_b16_u64(uint64_t, uint64_t);
19424__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b8_s32)))
19425svbool_t svwhilegt_b8_s32(int32_t, int32_t);
19426__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b32_s32)))
19427svbool_t svwhilegt_b32_s32(int32_t, int32_t);
19428__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b64_s32)))
19429svbool_t svwhilegt_b64_s32(int32_t, int32_t);
19430__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b16_s32)))
19431svbool_t svwhilegt_b16_s32(int32_t, int32_t);
19432__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b8_s64)))
19433svbool_t svwhilegt_b8_s64(int64_t, int64_t);
19434__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b32_s64)))
19435svbool_t svwhilegt_b32_s64(int64_t, int64_t);
19436__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b64_s64)))
19437svbool_t svwhilegt_b64_s64(int64_t, int64_t);
19438__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b16_s64)))
19439svbool_t svwhilegt_b16_s64(int64_t, int64_t);
19440__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b8_u32)))
19441svbool_t svwhilegt_b8_u32(uint32_t, uint32_t);
19442__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b32_u32)))
19443svbool_t svwhilegt_b32_u32(uint32_t, uint32_t);
19444__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b64_u32)))
19445svbool_t svwhilegt_b64_u32(uint32_t, uint32_t);
19446__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b16_u32)))
19447svbool_t svwhilegt_b16_u32(uint32_t, uint32_t);
19448__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b8_u64)))
19449svbool_t svwhilegt_b8_u64(uint64_t, uint64_t);
19450__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b32_u64)))
19451svbool_t svwhilegt_b32_u64(uint64_t, uint64_t);
19452__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b64_u64)))
19453svbool_t svwhilegt_b64_u64(uint64_t, uint64_t);
19454__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b16_u64)))
19455svbool_t svwhilegt_b16_u64(uint64_t, uint64_t);
19456__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_u8)))
19457svbool_t svwhilerw_u8(uint8_t const *, uint8_t const *);
19458__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_s8)))
19459svbool_t svwhilerw_s8(int8_t const *, int8_t const *);
19460__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_u64)))
19461svbool_t svwhilerw_u64(uint64_t const *, uint64_t const *);
19462__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_f64)))
19463svbool_t svwhilerw_f64(float64_t const *, float64_t const *);
19464__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_s64)))
19465svbool_t svwhilerw_s64(int64_t const *, int64_t const *);
19466__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_u16)))
19467svbool_t svwhilerw_u16(uint16_t const *, uint16_t const *);
19468__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_f16)))
19469svbool_t svwhilerw_f16(float16_t const *, float16_t const *);
19470__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_s16)))
19471svbool_t svwhilerw_s16(int16_t const *, int16_t const *);
19472__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_u32)))
19473svbool_t svwhilerw_u32(uint32_t const *, uint32_t const *);
19474__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_f32)))
19475svbool_t svwhilerw_f32(float32_t const *, float32_t const *);
19476__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_s32)))
19477svbool_t svwhilerw_s32(int32_t const *, int32_t const *);
19478__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_u8)))
19479svbool_t svwhilewr_u8(uint8_t const *, uint8_t const *);
19480__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_s8)))
19481svbool_t svwhilewr_s8(int8_t const *, int8_t const *);
19482__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_u64)))
19483svbool_t svwhilewr_u64(uint64_t const *, uint64_t const *);
19484__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_f64)))
19485svbool_t svwhilewr_f64(float64_t const *, float64_t const *);
19486__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_s64)))
19487svbool_t svwhilewr_s64(int64_t const *, int64_t const *);
19488__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_u16)))
19489svbool_t svwhilewr_u16(uint16_t const *, uint16_t const *);
19490__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_f16)))
19491svbool_t svwhilewr_f16(float16_t const *, float16_t const *);
19492__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_s16)))
19493svbool_t svwhilewr_s16(int16_t const *, int16_t const *);
19494__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_u32)))
19495svbool_t svwhilewr_u32(uint32_t const *, uint32_t const *);
19496__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_f32)))
19497svbool_t svwhilewr_f32(float32_t const *, float32_t const *);
19498__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_s32)))
19499svbool_t svwhilewr_s32(int32_t const *, int32_t const *);
19500__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_u8)))
19501svuint8_t svxar_n_u8(svuint8_t, svuint8_t, uint64_t);
19502__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_u32)))
19503svuint32_t svxar_n_u32(svuint32_t, svuint32_t, uint64_t);
19504__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_u64)))
19505svuint64_t svxar_n_u64(svuint64_t, svuint64_t, uint64_t);
19506__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_u16)))
19507svuint16_t svxar_n_u16(svuint16_t, svuint16_t, uint64_t);
19508__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_s8)))
19509svint8_t svxar_n_s8(svint8_t, svint8_t, uint64_t);
19510__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_s32)))
19511svint32_t svxar_n_s32(svint32_t, svint32_t, uint64_t);
19512__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_s64)))
19513svint64_t svxar_n_s64(svint64_t, svint64_t, uint64_t);
19514__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_s16)))
19515svint16_t svxar_n_s16(svint16_t, svint16_t, uint64_t);
19516__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_s8)))
19517svint8_t svaba(svint8_t, svint8_t, int8_t);
19518__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_s32)))
19519svint32_t svaba(svint32_t, svint32_t, int32_t);
19520__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_s64)))
19521svint64_t svaba(svint64_t, svint64_t, int64_t);
19522__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_s16)))
19523svint16_t svaba(svint16_t, svint16_t, int16_t);
19524__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_u8)))
19525svuint8_t svaba(svuint8_t, svuint8_t, uint8_t);
19526__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_u32)))
19527svuint32_t svaba(svuint32_t, svuint32_t, uint32_t);
19528__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_u64)))
19529svuint64_t svaba(svuint64_t, svuint64_t, uint64_t);
19530__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_u16)))
19531svuint16_t svaba(svuint16_t, svuint16_t, uint16_t);
19532__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_s8)))
19533svint8_t svaba(svint8_t, svint8_t, svint8_t);
19534__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_s32)))
19535svint32_t svaba(svint32_t, svint32_t, svint32_t);
19536__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_s64)))
19537svint64_t svaba(svint64_t, svint64_t, svint64_t);
19538__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_s16)))
19539svint16_t svaba(svint16_t, svint16_t, svint16_t);
19540__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_u8)))
19541svuint8_t svaba(svuint8_t, svuint8_t, svuint8_t);
19542__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_u32)))
19543svuint32_t svaba(svuint32_t, svuint32_t, svuint32_t);
19544__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_u64)))
19545svuint64_t svaba(svuint64_t, svuint64_t, svuint64_t);
19546__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_u16)))
19547svuint16_t svaba(svuint16_t, svuint16_t, svuint16_t);
19548__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_n_s32)))
19549svint32_t svabalb(svint32_t, svint16_t, int16_t);
19550__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_n_s64)))
19551svint64_t svabalb(svint64_t, svint32_t, int32_t);
19552__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_n_s16)))
19553svint16_t svabalb(svint16_t, svint8_t, int8_t);
19554__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_n_u32)))
19555svuint32_t svabalb(svuint32_t, svuint16_t, uint16_t);
19556__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_n_u64)))
19557svuint64_t svabalb(svuint64_t, svuint32_t, uint32_t);
19558__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_n_u16)))
19559svuint16_t svabalb(svuint16_t, svuint8_t, uint8_t);
19560__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_s32)))
19561svint32_t svabalb(svint32_t, svint16_t, svint16_t);
19562__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_s64)))
19563svint64_t svabalb(svint64_t, svint32_t, svint32_t);
19564__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_s16)))
19565svint16_t svabalb(svint16_t, svint8_t, svint8_t);
19566__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_u32)))
19567svuint32_t svabalb(svuint32_t, svuint16_t, svuint16_t);
19568__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_u64)))
19569svuint64_t svabalb(svuint64_t, svuint32_t, svuint32_t);
19570__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_u16)))
19571svuint16_t svabalb(svuint16_t, svuint8_t, svuint8_t);
19572__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_n_s32)))
19573svint32_t svabalt(svint32_t, svint16_t, int16_t);
19574__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_n_s64)))
19575svint64_t svabalt(svint64_t, svint32_t, int32_t);
19576__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_n_s16)))
19577svint16_t svabalt(svint16_t, svint8_t, int8_t);
19578__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_n_u32)))
19579svuint32_t svabalt(svuint32_t, svuint16_t, uint16_t);
19580__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_n_u64)))
19581svuint64_t svabalt(svuint64_t, svuint32_t, uint32_t);
19582__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_n_u16)))
19583svuint16_t svabalt(svuint16_t, svuint8_t, uint8_t);
19584__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_s32)))
19585svint32_t svabalt(svint32_t, svint16_t, svint16_t);
19586__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_s64)))
19587svint64_t svabalt(svint64_t, svint32_t, svint32_t);
19588__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_s16)))
19589svint16_t svabalt(svint16_t, svint8_t, svint8_t);
19590__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_u32)))
19591svuint32_t svabalt(svuint32_t, svuint16_t, svuint16_t);
19592__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_u64)))
19593svuint64_t svabalt(svuint64_t, svuint32_t, svuint32_t);
19594__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_u16)))
19595svuint16_t svabalt(svuint16_t, svuint8_t, svuint8_t);
19596__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_n_s32)))
19597svint32_t svabdlb(svint16_t, int16_t);
19598__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_n_s64)))
19599svint64_t svabdlb(svint32_t, int32_t);
19600__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_n_s16)))
19601svint16_t svabdlb(svint8_t, int8_t);
19602__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_n_u32)))
19603svuint32_t svabdlb(svuint16_t, uint16_t);
19604__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_n_u64)))
19605svuint64_t svabdlb(svuint32_t, uint32_t);
19606__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_n_u16)))
19607svuint16_t svabdlb(svuint8_t, uint8_t);
19608__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_s32)))
19609svint32_t svabdlb(svint16_t, svint16_t);
19610__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_s64)))
19611svint64_t svabdlb(svint32_t, svint32_t);
19612__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_s16)))
19613svint16_t svabdlb(svint8_t, svint8_t);
19614__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_u32)))
19615svuint32_t svabdlb(svuint16_t, svuint16_t);
19616__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_u64)))
19617svuint64_t svabdlb(svuint32_t, svuint32_t);
19618__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_u16)))
19619svuint16_t svabdlb(svuint8_t, svuint8_t);
19620__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_n_s32)))
19621svint32_t svabdlt(svint16_t, int16_t);
19622__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_n_s64)))
19623svint64_t svabdlt(svint32_t, int32_t);
19624__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_n_s16)))
19625svint16_t svabdlt(svint8_t, int8_t);
19626__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_n_u32)))
19627svuint32_t svabdlt(svuint16_t, uint16_t);
19628__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_n_u64)))
19629svuint64_t svabdlt(svuint32_t, uint32_t);
19630__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_n_u16)))
19631svuint16_t svabdlt(svuint8_t, uint8_t);
19632__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_s32)))
19633svint32_t svabdlt(svint16_t, svint16_t);
19634__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_s64)))
19635svint64_t svabdlt(svint32_t, svint32_t);
19636__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_s16)))
19637svint16_t svabdlt(svint8_t, svint8_t);
19638__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_u32)))
19639svuint32_t svabdlt(svuint16_t, svuint16_t);
19640__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_u64)))
19641svuint64_t svabdlt(svuint32_t, svuint32_t);
19642__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_u16)))
19643svuint16_t svabdlt(svuint8_t, svuint8_t);
19644__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s32_m)))
19645svint32_t svadalp_m(svbool_t, svint32_t, svint16_t);
19646__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s64_m)))
19647svint64_t svadalp_m(svbool_t, svint64_t, svint32_t);
19648__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s16_m)))
19649svint16_t svadalp_m(svbool_t, svint16_t, svint8_t);
19650__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s32_x)))
19651svint32_t svadalp_x(svbool_t, svint32_t, svint16_t);
19652__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s64_x)))
19653svint64_t svadalp_x(svbool_t, svint64_t, svint32_t);
19654__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s16_x)))
19655svint16_t svadalp_x(svbool_t, svint16_t, svint8_t);
19656__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s32_z)))
19657svint32_t svadalp_z(svbool_t, svint32_t, svint16_t);
19658__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s64_z)))
19659svint64_t svadalp_z(svbool_t, svint64_t, svint32_t);
19660__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s16_z)))
19661svint16_t svadalp_z(svbool_t, svint16_t, svint8_t);
19662__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u32_m)))
19663svuint32_t svadalp_m(svbool_t, svuint32_t, svuint16_t);
19664__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u64_m)))
19665svuint64_t svadalp_m(svbool_t, svuint64_t, svuint32_t);
19666__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u16_m)))
19667svuint16_t svadalp_m(svbool_t, svuint16_t, svuint8_t);
19668__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u32_x)))
19669svuint32_t svadalp_x(svbool_t, svuint32_t, svuint16_t);
19670__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u64_x)))
19671svuint64_t svadalp_x(svbool_t, svuint64_t, svuint32_t);
19672__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u16_x)))
19673svuint16_t svadalp_x(svbool_t, svuint16_t, svuint8_t);
19674__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u32_z)))
19675svuint32_t svadalp_z(svbool_t, svuint32_t, svuint16_t);
19676__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u64_z)))
19677svuint64_t svadalp_z(svbool_t, svuint64_t, svuint32_t);
19678__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u16_z)))
19679svuint16_t svadalp_z(svbool_t, svuint16_t, svuint8_t);
19680__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclb_n_u32)))
19681svuint32_t svadclb(svuint32_t, svuint32_t, uint32_t);
19682__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclb_n_u64)))
19683svuint64_t svadclb(svuint64_t, svuint64_t, uint64_t);
19684__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclb_u32)))
19685svuint32_t svadclb(svuint32_t, svuint32_t, svuint32_t);
19686__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclb_u64)))
19687svuint64_t svadclb(svuint64_t, svuint64_t, svuint64_t);
19688__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclt_n_u32)))
19689svuint32_t svadclt(svuint32_t, svuint32_t, uint32_t);
19690__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclt_n_u64)))
19691svuint64_t svadclt(svuint64_t, svuint64_t, uint64_t);
19692__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclt_u32)))
19693svuint32_t svadclt(svuint32_t, svuint32_t, svuint32_t);
19694__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclt_u64)))
19695svuint64_t svadclt(svuint64_t, svuint64_t, svuint64_t);
19696__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_n_u32)))
19697svuint16_t svaddhnb(svuint32_t, uint32_t);
19698__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_n_u64)))
19699svuint32_t svaddhnb(svuint64_t, uint64_t);
19700__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_n_u16)))
19701svuint8_t svaddhnb(svuint16_t, uint16_t);
19702__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_n_s32)))
19703svint16_t svaddhnb(svint32_t, int32_t);
19704__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_n_s64)))
19705svint32_t svaddhnb(svint64_t, int64_t);
19706__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_n_s16)))
19707svint8_t svaddhnb(svint16_t, int16_t);
19708__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_u32)))
19709svuint16_t svaddhnb(svuint32_t, svuint32_t);
19710__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_u64)))
19711svuint32_t svaddhnb(svuint64_t, svuint64_t);
19712__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_u16)))
19713svuint8_t svaddhnb(svuint16_t, svuint16_t);
19714__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_s32)))
19715svint16_t svaddhnb(svint32_t, svint32_t);
19716__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_s64)))
19717svint32_t svaddhnb(svint64_t, svint64_t);
19718__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_s16)))
19719svint8_t svaddhnb(svint16_t, svint16_t);
19720__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_n_u32)))
19721svuint16_t svaddhnt(svuint16_t, svuint32_t, uint32_t);
19722__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_n_u64)))
19723svuint32_t svaddhnt(svuint32_t, svuint64_t, uint64_t);
19724__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_n_u16)))
19725svuint8_t svaddhnt(svuint8_t, svuint16_t, uint16_t);
19726__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_n_s32)))
19727svint16_t svaddhnt(svint16_t, svint32_t, int32_t);
19728__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_n_s64)))
19729svint32_t svaddhnt(svint32_t, svint64_t, int64_t);
19730__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_n_s16)))
19731svint8_t svaddhnt(svint8_t, svint16_t, int16_t);
19732__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_u32)))
19733svuint16_t svaddhnt(svuint16_t, svuint32_t, svuint32_t);
19734__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_u64)))
19735svuint32_t svaddhnt(svuint32_t, svuint64_t, svuint64_t);
19736__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_u16)))
19737svuint8_t svaddhnt(svuint8_t, svuint16_t, svuint16_t);
19738__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_s32)))
19739svint16_t svaddhnt(svint16_t, svint32_t, svint32_t);
19740__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_s64)))
19741svint32_t svaddhnt(svint32_t, svint64_t, svint64_t);
19742__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_s16)))
19743svint8_t svaddhnt(svint8_t, svint16_t, svint16_t);
19744__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_n_s32)))
19745svint32_t svaddlb(svint16_t, int16_t);
19746__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_n_s64)))
19747svint64_t svaddlb(svint32_t, int32_t);
19748__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_n_s16)))
19749svint16_t svaddlb(svint8_t, int8_t);
19750__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_n_u32)))
19751svuint32_t svaddlb(svuint16_t, uint16_t);
19752__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_n_u64)))
19753svuint64_t svaddlb(svuint32_t, uint32_t);
19754__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_n_u16)))
19755svuint16_t svaddlb(svuint8_t, uint8_t);
19756__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_s32)))
19757svint32_t svaddlb(svint16_t, svint16_t);
19758__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_s64)))
19759svint64_t svaddlb(svint32_t, svint32_t);
19760__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_s16)))
19761svint16_t svaddlb(svint8_t, svint8_t);
19762__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_u32)))
19763svuint32_t svaddlb(svuint16_t, svuint16_t);
19764__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_u64)))
19765svuint64_t svaddlb(svuint32_t, svuint32_t);
19766__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_u16)))
19767svuint16_t svaddlb(svuint8_t, svuint8_t);
19768__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlbt_n_s32)))
19769svint32_t svaddlbt(svint16_t, int16_t);
19770__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlbt_n_s64)))
19771svint64_t svaddlbt(svint32_t, int32_t);
19772__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlbt_n_s16)))
19773svint16_t svaddlbt(svint8_t, int8_t);
19774__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlbt_s32)))
19775svint32_t svaddlbt(svint16_t, svint16_t);
19776__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlbt_s64)))
19777svint64_t svaddlbt(svint32_t, svint32_t);
19778__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlbt_s16)))
19779svint16_t svaddlbt(svint8_t, svint8_t);
19780__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_n_s32)))
19781svint32_t svaddlt(svint16_t, int16_t);
19782__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_n_s64)))
19783svint64_t svaddlt(svint32_t, int32_t);
19784__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_n_s16)))
19785svint16_t svaddlt(svint8_t, int8_t);
19786__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_n_u32)))
19787svuint32_t svaddlt(svuint16_t, uint16_t);
19788__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_n_u64)))
19789svuint64_t svaddlt(svuint32_t, uint32_t);
19790__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_n_u16)))
19791svuint16_t svaddlt(svuint8_t, uint8_t);
19792__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_s32)))
19793svint32_t svaddlt(svint16_t, svint16_t);
19794__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_s64)))
19795svint64_t svaddlt(svint32_t, svint32_t);
19796__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_s16)))
19797svint16_t svaddlt(svint8_t, svint8_t);
19798__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_u32)))
19799svuint32_t svaddlt(svuint16_t, svuint16_t);
19800__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_u64)))
19801svuint64_t svaddlt(svuint32_t, svuint32_t);
19802__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_u16)))
19803svuint16_t svaddlt(svuint8_t, svuint8_t);
19804__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_f64_m)))
19805svfloat64_t svaddp_m(svbool_t, svfloat64_t, svfloat64_t);
19806__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_f32_m)))
19807svfloat32_t svaddp_m(svbool_t, svfloat32_t, svfloat32_t);
19808__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_f16_m)))
19809svfloat16_t svaddp_m(svbool_t, svfloat16_t, svfloat16_t);
19810__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_f64_x)))
19811svfloat64_t svaddp_x(svbool_t, svfloat64_t, svfloat64_t);
19812__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_f32_x)))
19813svfloat32_t svaddp_x(svbool_t, svfloat32_t, svfloat32_t);
19814__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_f16_x)))
19815svfloat16_t svaddp_x(svbool_t, svfloat16_t, svfloat16_t);
19816__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u8_m)))
19817svuint8_t svaddp_m(svbool_t, svuint8_t, svuint8_t);
19818__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u32_m)))
19819svuint32_t svaddp_m(svbool_t, svuint32_t, svuint32_t);
19820__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u64_m)))
19821svuint64_t svaddp_m(svbool_t, svuint64_t, svuint64_t);
19822__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u16_m)))
19823svuint16_t svaddp_m(svbool_t, svuint16_t, svuint16_t);
19824__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s8_m)))
19825svint8_t svaddp_m(svbool_t, svint8_t, svint8_t);
19826__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s32_m)))
19827svint32_t svaddp_m(svbool_t, svint32_t, svint32_t);
19828__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s64_m)))
19829svint64_t svaddp_m(svbool_t, svint64_t, svint64_t);
19830__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s16_m)))
19831svint16_t svaddp_m(svbool_t, svint16_t, svint16_t);
19832__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u8_x)))
19833svuint8_t svaddp_x(svbool_t, svuint8_t, svuint8_t);
19834__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u32_x)))
19835svuint32_t svaddp_x(svbool_t, svuint32_t, svuint32_t);
19836__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u64_x)))
19837svuint64_t svaddp_x(svbool_t, svuint64_t, svuint64_t);
19838__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u16_x)))
19839svuint16_t svaddp_x(svbool_t, svuint16_t, svuint16_t);
19840__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s8_x)))
19841svint8_t svaddp_x(svbool_t, svint8_t, svint8_t);
19842__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s32_x)))
19843svint32_t svaddp_x(svbool_t, svint32_t, svint32_t);
19844__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s64_x)))
19845svint64_t svaddp_x(svbool_t, svint64_t, svint64_t);
19846__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s16_x)))
19847svint16_t svaddp_x(svbool_t, svint16_t, svint16_t);
19848__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_n_s32)))
19849svint32_t svaddwb(svint32_t, int16_t);
19850__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_n_s64)))
19851svint64_t svaddwb(svint64_t, int32_t);
19852__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_n_s16)))
19853svint16_t svaddwb(svint16_t, int8_t);
19854__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_n_u32)))
19855svuint32_t svaddwb(svuint32_t, uint16_t);
19856__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_n_u64)))
19857svuint64_t svaddwb(svuint64_t, uint32_t);
19858__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_n_u16)))
19859svuint16_t svaddwb(svuint16_t, uint8_t);
19860__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_s32)))
19861svint32_t svaddwb(svint32_t, svint16_t);
19862__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_s64)))
19863svint64_t svaddwb(svint64_t, svint32_t);
19864__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_s16)))
19865svint16_t svaddwb(svint16_t, svint8_t);
19866__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_u32)))
19867svuint32_t svaddwb(svuint32_t, svuint16_t);
19868__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_u64)))
19869svuint64_t svaddwb(svuint64_t, svuint32_t);
19870__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_u16)))
19871svuint16_t svaddwb(svuint16_t, svuint8_t);
19872__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_n_s32)))
19873svint32_t svaddwt(svint32_t, int16_t);
19874__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_n_s64)))
19875svint64_t svaddwt(svint64_t, int32_t);
19876__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_n_s16)))
19877svint16_t svaddwt(svint16_t, int8_t);
19878__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_n_u32)))
19879svuint32_t svaddwt(svuint32_t, uint16_t);
19880__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_n_u64)))
19881svuint64_t svaddwt(svuint64_t, uint32_t);
19882__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_n_u16)))
19883svuint16_t svaddwt(svuint16_t, uint8_t);
19884__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_s32)))
19885svint32_t svaddwt(svint32_t, svint16_t);
19886__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_s64)))
19887svint64_t svaddwt(svint64_t, svint32_t);
19888__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_s16)))
19889svint16_t svaddwt(svint16_t, svint8_t);
19890__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_u32)))
19891svuint32_t svaddwt(svuint32_t, svuint16_t);
19892__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_u64)))
19893svuint64_t svaddwt(svuint64_t, svuint32_t);
19894__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_u16)))
19895svuint16_t svaddwt(svuint16_t, svuint8_t);
19896__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_u8)))
19897svuint8_t svbcax(svuint8_t, svuint8_t, uint8_t);
19898__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_u32)))
19899svuint32_t svbcax(svuint32_t, svuint32_t, uint32_t);
19900__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_u64)))
19901svuint64_t svbcax(svuint64_t, svuint64_t, uint64_t);
19902__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_u16)))
19903svuint16_t svbcax(svuint16_t, svuint16_t, uint16_t);
19904__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_s8)))
19905svint8_t svbcax(svint8_t, svint8_t, int8_t);
19906__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_s32)))
19907svint32_t svbcax(svint32_t, svint32_t, int32_t);
19908__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_s64)))
19909svint64_t svbcax(svint64_t, svint64_t, int64_t);
19910__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_s16)))
19911svint16_t svbcax(svint16_t, svint16_t, int16_t);
19912__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_u8)))
19913svuint8_t svbcax(svuint8_t, svuint8_t, svuint8_t);
19914__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_u32)))
19915svuint32_t svbcax(svuint32_t, svuint32_t, svuint32_t);
19916__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_u64)))
19917svuint64_t svbcax(svuint64_t, svuint64_t, svuint64_t);
19918__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_u16)))
19919svuint16_t svbcax(svuint16_t, svuint16_t, svuint16_t);
19920__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_s8)))
19921svint8_t svbcax(svint8_t, svint8_t, svint8_t);
19922__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_s32)))
19923svint32_t svbcax(svint32_t, svint32_t, svint32_t);
19924__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_s64)))
19925svint64_t svbcax(svint64_t, svint64_t, svint64_t);
19926__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_s16)))
19927svint16_t svbcax(svint16_t, svint16_t, svint16_t);
19928__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_u8)))
19929svuint8_t svbsl1n(svuint8_t, svuint8_t, uint8_t);
19930__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_u32)))
19931svuint32_t svbsl1n(svuint32_t, svuint32_t, uint32_t);
19932__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_u64)))
19933svuint64_t svbsl1n(svuint64_t, svuint64_t, uint64_t);
19934__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_u16)))
19935svuint16_t svbsl1n(svuint16_t, svuint16_t, uint16_t);
19936__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_s8)))
19937svint8_t svbsl1n(svint8_t, svint8_t, int8_t);
19938__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_s32)))
19939svint32_t svbsl1n(svint32_t, svint32_t, int32_t);
19940__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_s64)))
19941svint64_t svbsl1n(svint64_t, svint64_t, int64_t);
19942__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_s16)))
19943svint16_t svbsl1n(svint16_t, svint16_t, int16_t);
19944__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_u8)))
19945svuint8_t svbsl1n(svuint8_t, svuint8_t, svuint8_t);
19946__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_u32)))
19947svuint32_t svbsl1n(svuint32_t, svuint32_t, svuint32_t);
19948__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_u64)))
19949svuint64_t svbsl1n(svuint64_t, svuint64_t, svuint64_t);
19950__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_u16)))
19951svuint16_t svbsl1n(svuint16_t, svuint16_t, svuint16_t);
19952__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_s8)))
19953svint8_t svbsl1n(svint8_t, svint8_t, svint8_t);
19954__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_s32)))
19955svint32_t svbsl1n(svint32_t, svint32_t, svint32_t);
19956__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_s64)))
19957svint64_t svbsl1n(svint64_t, svint64_t, svint64_t);
19958__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_s16)))
19959svint16_t svbsl1n(svint16_t, svint16_t, svint16_t);
19960__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_u8)))
19961svuint8_t svbsl2n(svuint8_t, svuint8_t, uint8_t);
19962__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_u32)))
19963svuint32_t svbsl2n(svuint32_t, svuint32_t, uint32_t);
19964__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_u64)))
19965svuint64_t svbsl2n(svuint64_t, svuint64_t, uint64_t);
19966__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_u16)))
19967svuint16_t svbsl2n(svuint16_t, svuint16_t, uint16_t);
19968__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_s8)))
19969svint8_t svbsl2n(svint8_t, svint8_t, int8_t);
19970__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_s32)))
19971svint32_t svbsl2n(svint32_t, svint32_t, int32_t);
19972__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_s64)))
19973svint64_t svbsl2n(svint64_t, svint64_t, int64_t);
19974__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_s16)))
19975svint16_t svbsl2n(svint16_t, svint16_t, int16_t);
19976__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_u8)))
19977svuint8_t svbsl2n(svuint8_t, svuint8_t, svuint8_t);
19978__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_u32)))
19979svuint32_t svbsl2n(svuint32_t, svuint32_t, svuint32_t);
19980__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_u64)))
19981svuint64_t svbsl2n(svuint64_t, svuint64_t, svuint64_t);
19982__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_u16)))
19983svuint16_t svbsl2n(svuint16_t, svuint16_t, svuint16_t);
19984__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_s8)))
19985svint8_t svbsl2n(svint8_t, svint8_t, svint8_t);
19986__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_s32)))
19987svint32_t svbsl2n(svint32_t, svint32_t, svint32_t);
19988__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_s64)))
19989svint64_t svbsl2n(svint64_t, svint64_t, svint64_t);
19990__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_s16)))
19991svint16_t svbsl2n(svint16_t, svint16_t, svint16_t);
19992__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_u8)))
19993svuint8_t svbsl(svuint8_t, svuint8_t, uint8_t);
19994__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_u32)))
19995svuint32_t svbsl(svuint32_t, svuint32_t, uint32_t);
19996__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_u64)))
19997svuint64_t svbsl(svuint64_t, svuint64_t, uint64_t);
19998__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_u16)))
19999svuint16_t svbsl(svuint16_t, svuint16_t, uint16_t);
20000__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_s8)))
20001svint8_t svbsl(svint8_t, svint8_t, int8_t);
20002__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_s32)))
20003svint32_t svbsl(svint32_t, svint32_t, int32_t);
20004__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_s64)))
20005svint64_t svbsl(svint64_t, svint64_t, int64_t);
20006__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_s16)))
20007svint16_t svbsl(svint16_t, svint16_t, int16_t);
20008__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_u8)))
20009svuint8_t svbsl(svuint8_t, svuint8_t, svuint8_t);
20010__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_u32)))
20011svuint32_t svbsl(svuint32_t, svuint32_t, svuint32_t);
20012__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_u64)))
20013svuint64_t svbsl(svuint64_t, svuint64_t, svuint64_t);
20014__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_u16)))
20015svuint16_t svbsl(svuint16_t, svuint16_t, svuint16_t);
20016__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_s8)))
20017svint8_t svbsl(svint8_t, svint8_t, svint8_t);
20018__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_s32)))
20019svint32_t svbsl(svint32_t, svint32_t, svint32_t);
20020__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_s64)))
20021svint64_t svbsl(svint64_t, svint64_t, svint64_t);
20022__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_s16)))
20023svint16_t svbsl(svint16_t, svint16_t, svint16_t);
20024__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_u8)))
20025svuint8_t svcadd(svuint8_t, svuint8_t, uint64_t);
20026__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_u32)))
20027svuint32_t svcadd(svuint32_t, svuint32_t, uint64_t);
20028__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_u64)))
20029svuint64_t svcadd(svuint64_t, svuint64_t, uint64_t);
20030__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_u16)))
20031svuint16_t svcadd(svuint16_t, svuint16_t, uint64_t);
20032__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_s8)))
20033svint8_t svcadd(svint8_t, svint8_t, uint64_t);
20034__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_s32)))
20035svint32_t svcadd(svint32_t, svint32_t, uint64_t);
20036__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_s64)))
20037svint64_t svcadd(svint64_t, svint64_t, uint64_t);
20038__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_s16)))
20039svint16_t svcadd(svint16_t, svint16_t, uint64_t);
20040__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcdot_s32)))
20041svint32_t svcdot(svint32_t, svint8_t, svint8_t, uint64_t);
20042__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcdot_s64)))
20043svint64_t svcdot(svint64_t, svint16_t, svint16_t, uint64_t);
20044__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcdot_lane_s32)))
20045svint32_t svcdot_lane(svint32_t, svint8_t, svint8_t, uint64_t, uint64_t);
20046__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcdot_lane_s64)))
20047svint64_t svcdot_lane(svint64_t, svint16_t, svint16_t, uint64_t, uint64_t);
20048__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_u8)))
20049svuint8_t svcmla(svuint8_t, svuint8_t, svuint8_t, uint64_t);
20050__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_u32)))
20051svuint32_t svcmla(svuint32_t, svuint32_t, svuint32_t, uint64_t);
20052__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_u64)))
20053svuint64_t svcmla(svuint64_t, svuint64_t, svuint64_t, uint64_t);
20054__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_u16)))
20055svuint16_t svcmla(svuint16_t, svuint16_t, svuint16_t, uint64_t);
20056__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_s8)))
20057svint8_t svcmla(svint8_t, svint8_t, svint8_t, uint64_t);
20058__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_s32)))
20059svint32_t svcmla(svint32_t, svint32_t, svint32_t, uint64_t);
20060__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_s64)))
20061svint64_t svcmla(svint64_t, svint64_t, svint64_t, uint64_t);
20062__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_s16)))
20063svint16_t svcmla(svint16_t, svint16_t, svint16_t, uint64_t);
20064__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_lane_u32)))
20065svuint32_t svcmla_lane(svuint32_t, svuint32_t, svuint32_t, uint64_t, uint64_t);
20066__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_lane_u16)))
20067svuint16_t svcmla_lane(svuint16_t, svuint16_t, svuint16_t, uint64_t, uint64_t);
20068__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_lane_s32)))
20069svint32_t svcmla_lane(svint32_t, svint32_t, svint32_t, uint64_t, uint64_t);
20070__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_lane_s16)))
20071svint16_t svcmla_lane(svint16_t, svint16_t, svint16_t, uint64_t, uint64_t);
20072__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtlt_f32_f16_m)))
20073svfloat32_t svcvtlt_f32_m(svfloat32_t, svbool_t, svfloat16_t);
20074__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtlt_f32_f16_x)))
20075svfloat32_t svcvtlt_f32_x(svbool_t, svfloat16_t);
20076__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtlt_f64_f32_m)))
20077svfloat64_t svcvtlt_f64_m(svfloat64_t, svbool_t, svfloat32_t);
20078__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtlt_f64_f32_x)))
20079svfloat64_t svcvtlt_f64_x(svbool_t, svfloat32_t);
20080__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtnt_f16_f32_m)))
20081svfloat16_t svcvtnt_f16_m(svfloat16_t, svbool_t, svfloat32_t);
20082__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtnt_f32_f64_m)))
20083svfloat32_t svcvtnt_f32_m(svfloat32_t, svbool_t, svfloat64_t);
20084__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtx_f32_f64_m)))
20085svfloat32_t svcvtx_f32_m(svfloat32_t, svbool_t, svfloat64_t);
20086__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtx_f32_f64_x)))
20087svfloat32_t svcvtx_f32_x(svbool_t, svfloat64_t);
20088__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtx_f32_f64_z)))
20089svfloat32_t svcvtx_f32_z(svbool_t, svfloat64_t);
20090__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtxnt_f32_f64_m)))
20091svfloat32_t svcvtxnt_f32_m(svfloat32_t, svbool_t, svfloat64_t);
20092__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_u8)))
20093svuint8_t sveor3(svuint8_t, svuint8_t, uint8_t);
20094__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_u32)))
20095svuint32_t sveor3(svuint32_t, svuint32_t, uint32_t);
20096__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_u64)))
20097svuint64_t sveor3(svuint64_t, svuint64_t, uint64_t);
20098__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_u16)))
20099svuint16_t sveor3(svuint16_t, svuint16_t, uint16_t);
20100__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_s8)))
20101svint8_t sveor3(svint8_t, svint8_t, int8_t);
20102__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_s32)))
20103svint32_t sveor3(svint32_t, svint32_t, int32_t);
20104__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_s64)))
20105svint64_t sveor3(svint64_t, svint64_t, int64_t);
20106__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_s16)))
20107svint16_t sveor3(svint16_t, svint16_t, int16_t);
20108__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_u8)))
20109svuint8_t sveor3(svuint8_t, svuint8_t, svuint8_t);
20110__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_u32)))
20111svuint32_t sveor3(svuint32_t, svuint32_t, svuint32_t);
20112__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_u64)))
20113svuint64_t sveor3(svuint64_t, svuint64_t, svuint64_t);
20114__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_u16)))
20115svuint16_t sveor3(svuint16_t, svuint16_t, svuint16_t);
20116__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_s8)))
20117svint8_t sveor3(svint8_t, svint8_t, svint8_t);
20118__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_s32)))
20119svint32_t sveor3(svint32_t, svint32_t, svint32_t);
20120__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_s64)))
20121svint64_t sveor3(svint64_t, svint64_t, svint64_t);
20122__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_s16)))
20123svint16_t sveor3(svint16_t, svint16_t, svint16_t);
20124__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_u8)))
20125svuint8_t sveorbt(svuint8_t, svuint8_t, uint8_t);
20126__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_u32)))
20127svuint32_t sveorbt(svuint32_t, svuint32_t, uint32_t);
20128__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_u64)))
20129svuint64_t sveorbt(svuint64_t, svuint64_t, uint64_t);
20130__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_u16)))
20131svuint16_t sveorbt(svuint16_t, svuint16_t, uint16_t);
20132__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_s8)))
20133svint8_t sveorbt(svint8_t, svint8_t, int8_t);
20134__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_s32)))
20135svint32_t sveorbt(svint32_t, svint32_t, int32_t);
20136__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_s64)))
20137svint64_t sveorbt(svint64_t, svint64_t, int64_t);
20138__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_s16)))
20139svint16_t sveorbt(svint16_t, svint16_t, int16_t);
20140__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_u8)))
20141svuint8_t sveorbt(svuint8_t, svuint8_t, svuint8_t);
20142__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_u32)))
20143svuint32_t sveorbt(svuint32_t, svuint32_t, svuint32_t);
20144__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_u64)))
20145svuint64_t sveorbt(svuint64_t, svuint64_t, svuint64_t);
20146__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_u16)))
20147svuint16_t sveorbt(svuint16_t, svuint16_t, svuint16_t);
20148__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_s8)))
20149svint8_t sveorbt(svint8_t, svint8_t, svint8_t);
20150__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_s32)))
20151svint32_t sveorbt(svint32_t, svint32_t, svint32_t);
20152__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_s64)))
20153svint64_t sveorbt(svint64_t, svint64_t, svint64_t);
20154__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_s16)))
20155svint16_t sveorbt(svint16_t, svint16_t, svint16_t);
20156__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_u8)))
20157svuint8_t sveortb(svuint8_t, svuint8_t, uint8_t);
20158__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_u32)))
20159svuint32_t sveortb(svuint32_t, svuint32_t, uint32_t);
20160__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_u64)))
20161svuint64_t sveortb(svuint64_t, svuint64_t, uint64_t);
20162__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_u16)))
20163svuint16_t sveortb(svuint16_t, svuint16_t, uint16_t);
20164__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_s8)))
20165svint8_t sveortb(svint8_t, svint8_t, int8_t);
20166__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_s32)))
20167svint32_t sveortb(svint32_t, svint32_t, int32_t);
20168__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_s64)))
20169svint64_t sveortb(svint64_t, svint64_t, int64_t);
20170__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_s16)))
20171svint16_t sveortb(svint16_t, svint16_t, int16_t);
20172__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_u8)))
20173svuint8_t sveortb(svuint8_t, svuint8_t, svuint8_t);
20174__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_u32)))
20175svuint32_t sveortb(svuint32_t, svuint32_t, svuint32_t);
20176__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_u64)))
20177svuint64_t sveortb(svuint64_t, svuint64_t, svuint64_t);
20178__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_u16)))
20179svuint16_t sveortb(svuint16_t, svuint16_t, svuint16_t);
20180__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_s8)))
20181svint8_t sveortb(svint8_t, svint8_t, svint8_t);
20182__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_s32)))
20183svint32_t sveortb(svint32_t, svint32_t, svint32_t);
20184__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_s64)))
20185svint64_t sveortb(svint64_t, svint64_t, svint64_t);
20186__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_s16)))
20187svint16_t sveortb(svint16_t, svint16_t, svint16_t);
20188__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s8_m)))
20189svint8_t svhadd_m(svbool_t, svint8_t, int8_t);
20190__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s32_m)))
20191svint32_t svhadd_m(svbool_t, svint32_t, int32_t);
20192__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s64_m)))
20193svint64_t svhadd_m(svbool_t, svint64_t, int64_t);
20194__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s16_m)))
20195svint16_t svhadd_m(svbool_t, svint16_t, int16_t);
20196__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s8_x)))
20197svint8_t svhadd_x(svbool_t, svint8_t, int8_t);
20198__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s32_x)))
20199svint32_t svhadd_x(svbool_t, svint32_t, int32_t);
20200__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s64_x)))
20201svint64_t svhadd_x(svbool_t, svint64_t, int64_t);
20202__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s16_x)))
20203svint16_t svhadd_x(svbool_t, svint16_t, int16_t);
20204__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s8_z)))
20205svint8_t svhadd_z(svbool_t, svint8_t, int8_t);
20206__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s32_z)))
20207svint32_t svhadd_z(svbool_t, svint32_t, int32_t);
20208__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s64_z)))
20209svint64_t svhadd_z(svbool_t, svint64_t, int64_t);
20210__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s16_z)))
20211svint16_t svhadd_z(svbool_t, svint16_t, int16_t);
20212__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u8_m)))
20213svuint8_t svhadd_m(svbool_t, svuint8_t, uint8_t);
20214__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u32_m)))
20215svuint32_t svhadd_m(svbool_t, svuint32_t, uint32_t);
20216__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u64_m)))
20217svuint64_t svhadd_m(svbool_t, svuint64_t, uint64_t);
20218__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u16_m)))
20219svuint16_t svhadd_m(svbool_t, svuint16_t, uint16_t);
20220__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u8_x)))
20221svuint8_t svhadd_x(svbool_t, svuint8_t, uint8_t);
20222__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u32_x)))
20223svuint32_t svhadd_x(svbool_t, svuint32_t, uint32_t);
20224__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u64_x)))
20225svuint64_t svhadd_x(svbool_t, svuint64_t, uint64_t);
20226__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u16_x)))
20227svuint16_t svhadd_x(svbool_t, svuint16_t, uint16_t);
20228__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u8_z)))
20229svuint8_t svhadd_z(svbool_t, svuint8_t, uint8_t);
20230__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u32_z)))
20231svuint32_t svhadd_z(svbool_t, svuint32_t, uint32_t);
20232__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u64_z)))
20233svuint64_t svhadd_z(svbool_t, svuint64_t, uint64_t);
20234__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u16_z)))
20235svuint16_t svhadd_z(svbool_t, svuint16_t, uint16_t);
20236__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s8_m)))
20237svint8_t svhadd_m(svbool_t, svint8_t, svint8_t);
20238__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s32_m)))
20239svint32_t svhadd_m(svbool_t, svint32_t, svint32_t);
20240__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s64_m)))
20241svint64_t svhadd_m(svbool_t, svint64_t, svint64_t);
20242__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s16_m)))
20243svint16_t svhadd_m(svbool_t, svint16_t, svint16_t);
20244__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s8_x)))
20245svint8_t svhadd_x(svbool_t, svint8_t, svint8_t);
20246__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s32_x)))
20247svint32_t svhadd_x(svbool_t, svint32_t, svint32_t);
20248__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s64_x)))
20249svint64_t svhadd_x(svbool_t, svint64_t, svint64_t);
20250__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s16_x)))
20251svint16_t svhadd_x(svbool_t, svint16_t, svint16_t);
20252__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s8_z)))
20253svint8_t svhadd_z(svbool_t, svint8_t, svint8_t);
20254__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s32_z)))
20255svint32_t svhadd_z(svbool_t, svint32_t, svint32_t);
20256__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s64_z)))
20257svint64_t svhadd_z(svbool_t, svint64_t, svint64_t);
20258__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s16_z)))
20259svint16_t svhadd_z(svbool_t, svint16_t, svint16_t);
20260__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u8_m)))
20261svuint8_t svhadd_m(svbool_t, svuint8_t, svuint8_t);
20262__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u32_m)))
20263svuint32_t svhadd_m(svbool_t, svuint32_t, svuint32_t);
20264__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u64_m)))
20265svuint64_t svhadd_m(svbool_t, svuint64_t, svuint64_t);
20266__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u16_m)))
20267svuint16_t svhadd_m(svbool_t, svuint16_t, svuint16_t);
20268__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u8_x)))
20269svuint8_t svhadd_x(svbool_t, svuint8_t, svuint8_t);
20270__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u32_x)))
20271svuint32_t svhadd_x(svbool_t, svuint32_t, svuint32_t);
20272__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u64_x)))
20273svuint64_t svhadd_x(svbool_t, svuint64_t, svuint64_t);
20274__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u16_x)))
20275svuint16_t svhadd_x(svbool_t, svuint16_t, svuint16_t);
20276__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u8_z)))
20277svuint8_t svhadd_z(svbool_t, svuint8_t, svuint8_t);
20278__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u32_z)))
20279svuint32_t svhadd_z(svbool_t, svuint32_t, svuint32_t);
20280__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u64_z)))
20281svuint64_t svhadd_z(svbool_t, svuint64_t, svuint64_t);
20282__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u16_z)))
20283svuint16_t svhadd_z(svbool_t, svuint16_t, svuint16_t);
20284__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhistcnt_u32_z)))
20285svuint32_t svhistcnt_z(svbool_t, svuint32_t, svuint32_t);
20286__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhistcnt_u64_z)))
20287svuint64_t svhistcnt_z(svbool_t, svuint64_t, svuint64_t);
20288__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhistcnt_s32_z)))
20289svuint32_t svhistcnt_z(svbool_t, svint32_t, svint32_t);
20290__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhistcnt_s64_z)))
20291svuint64_t svhistcnt_z(svbool_t, svint64_t, svint64_t);
20292__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhistseg_u8)))
20293svuint8_t svhistseg(svuint8_t, svuint8_t);
20294__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhistseg_s8)))
20295svuint8_t svhistseg(svint8_t, svint8_t);
20296__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s8_m)))
20297svint8_t svhsub_m(svbool_t, svint8_t, int8_t);
20298__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s32_m)))
20299svint32_t svhsub_m(svbool_t, svint32_t, int32_t);
20300__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s64_m)))
20301svint64_t svhsub_m(svbool_t, svint64_t, int64_t);
20302__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s16_m)))
20303svint16_t svhsub_m(svbool_t, svint16_t, int16_t);
20304__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s8_x)))
20305svint8_t svhsub_x(svbool_t, svint8_t, int8_t);
20306__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s32_x)))
20307svint32_t svhsub_x(svbool_t, svint32_t, int32_t);
20308__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s64_x)))
20309svint64_t svhsub_x(svbool_t, svint64_t, int64_t);
20310__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s16_x)))
20311svint16_t svhsub_x(svbool_t, svint16_t, int16_t);
20312__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s8_z)))
20313svint8_t svhsub_z(svbool_t, svint8_t, int8_t);
20314__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s32_z)))
20315svint32_t svhsub_z(svbool_t, svint32_t, int32_t);
20316__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s64_z)))
20317svint64_t svhsub_z(svbool_t, svint64_t, int64_t);
20318__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s16_z)))
20319svint16_t svhsub_z(svbool_t, svint16_t, int16_t);
20320__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u8_m)))
20321svuint8_t svhsub_m(svbool_t, svuint8_t, uint8_t);
20322__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u32_m)))
20323svuint32_t svhsub_m(svbool_t, svuint32_t, uint32_t);
20324__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u64_m)))
20325svuint64_t svhsub_m(svbool_t, svuint64_t, uint64_t);
20326__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u16_m)))
20327svuint16_t svhsub_m(svbool_t, svuint16_t, uint16_t);
20328__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u8_x)))
20329svuint8_t svhsub_x(svbool_t, svuint8_t, uint8_t);
20330__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u32_x)))
20331svuint32_t svhsub_x(svbool_t, svuint32_t, uint32_t);
20332__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u64_x)))
20333svuint64_t svhsub_x(svbool_t, svuint64_t, uint64_t);
20334__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u16_x)))
20335svuint16_t svhsub_x(svbool_t, svuint16_t, uint16_t);
20336__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u8_z)))
20337svuint8_t svhsub_z(svbool_t, svuint8_t, uint8_t);
20338__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u32_z)))
20339svuint32_t svhsub_z(svbool_t, svuint32_t, uint32_t);
20340__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u64_z)))
20341svuint64_t svhsub_z(svbool_t, svuint64_t, uint64_t);
20342__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u16_z)))
20343svuint16_t svhsub_z(svbool_t, svuint16_t, uint16_t);
20344__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s8_m)))
20345svint8_t svhsub_m(svbool_t, svint8_t, svint8_t);
20346__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s32_m)))
20347svint32_t svhsub_m(svbool_t, svint32_t, svint32_t);
20348__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s64_m)))
20349svint64_t svhsub_m(svbool_t, svint64_t, svint64_t);
20350__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s16_m)))
20351svint16_t svhsub_m(svbool_t, svint16_t, svint16_t);
20352__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s8_x)))
20353svint8_t svhsub_x(svbool_t, svint8_t, svint8_t);
20354__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s32_x)))
20355svint32_t svhsub_x(svbool_t, svint32_t, svint32_t);
20356__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s64_x)))
20357svint64_t svhsub_x(svbool_t, svint64_t, svint64_t);
20358__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s16_x)))
20359svint16_t svhsub_x(svbool_t, svint16_t, svint16_t);
20360__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s8_z)))
20361svint8_t svhsub_z(svbool_t, svint8_t, svint8_t);
20362__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s32_z)))
20363svint32_t svhsub_z(svbool_t, svint32_t, svint32_t);
20364__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s64_z)))
20365svint64_t svhsub_z(svbool_t, svint64_t, svint64_t);
20366__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s16_z)))
20367svint16_t svhsub_z(svbool_t, svint16_t, svint16_t);
20368__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u8_m)))
20369svuint8_t svhsub_m(svbool_t, svuint8_t, svuint8_t);
20370__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u32_m)))
20371svuint32_t svhsub_m(svbool_t, svuint32_t, svuint32_t);
20372__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u64_m)))
20373svuint64_t svhsub_m(svbool_t, svuint64_t, svuint64_t);
20374__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u16_m)))
20375svuint16_t svhsub_m(svbool_t, svuint16_t, svuint16_t);
20376__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u8_x)))
20377svuint8_t svhsub_x(svbool_t, svuint8_t, svuint8_t);
20378__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u32_x)))
20379svuint32_t svhsub_x(svbool_t, svuint32_t, svuint32_t);
20380__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u64_x)))
20381svuint64_t svhsub_x(svbool_t, svuint64_t, svuint64_t);
20382__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u16_x)))
20383svuint16_t svhsub_x(svbool_t, svuint16_t, svuint16_t);
20384__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u8_z)))
20385svuint8_t svhsub_z(svbool_t, svuint8_t, svuint8_t);
20386__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u32_z)))
20387svuint32_t svhsub_z(svbool_t, svuint32_t, svuint32_t);
20388__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u64_z)))
20389svuint64_t svhsub_z(svbool_t, svuint64_t, svuint64_t);
20390__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u16_z)))
20391svuint16_t svhsub_z(svbool_t, svuint16_t, svuint16_t);
20392__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s8_m)))
20393svint8_t svhsubr_m(svbool_t, svint8_t, int8_t);
20394__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s32_m)))
20395svint32_t svhsubr_m(svbool_t, svint32_t, int32_t);
20396__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s64_m)))
20397svint64_t svhsubr_m(svbool_t, svint64_t, int64_t);
20398__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s16_m)))
20399svint16_t svhsubr_m(svbool_t, svint16_t, int16_t);
20400__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s8_x)))
20401svint8_t svhsubr_x(svbool_t, svint8_t, int8_t);
20402__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s32_x)))
20403svint32_t svhsubr_x(svbool_t, svint32_t, int32_t);
20404__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s64_x)))
20405svint64_t svhsubr_x(svbool_t, svint64_t, int64_t);
20406__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s16_x)))
20407svint16_t svhsubr_x(svbool_t, svint16_t, int16_t);
20408__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s8_z)))
20409svint8_t svhsubr_z(svbool_t, svint8_t, int8_t);
20410__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s32_z)))
20411svint32_t svhsubr_z(svbool_t, svint32_t, int32_t);
20412__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s64_z)))
20413svint64_t svhsubr_z(svbool_t, svint64_t, int64_t);
20414__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s16_z)))
20415svint16_t svhsubr_z(svbool_t, svint16_t, int16_t);
20416__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u8_m)))
20417svuint8_t svhsubr_m(svbool_t, svuint8_t, uint8_t);
20418__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u32_m)))
20419svuint32_t svhsubr_m(svbool_t, svuint32_t, uint32_t);
20420__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u64_m)))
20421svuint64_t svhsubr_m(svbool_t, svuint64_t, uint64_t);
20422__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u16_m)))
20423svuint16_t svhsubr_m(svbool_t, svuint16_t, uint16_t);
20424__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u8_x)))
20425svuint8_t svhsubr_x(svbool_t, svuint8_t, uint8_t);
20426__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u32_x)))
20427svuint32_t svhsubr_x(svbool_t, svuint32_t, uint32_t);
20428__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u64_x)))
20429svuint64_t svhsubr_x(svbool_t, svuint64_t, uint64_t);
20430__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u16_x)))
20431svuint16_t svhsubr_x(svbool_t, svuint16_t, uint16_t);
20432__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u8_z)))
20433svuint8_t svhsubr_z(svbool_t, svuint8_t, uint8_t);
20434__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u32_z)))
20435svuint32_t svhsubr_z(svbool_t, svuint32_t, uint32_t);
20436__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u64_z)))
20437svuint64_t svhsubr_z(svbool_t, svuint64_t, uint64_t);
20438__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u16_z)))
20439svuint16_t svhsubr_z(svbool_t, svuint16_t, uint16_t);
20440__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s8_m)))
20441svint8_t svhsubr_m(svbool_t, svint8_t, svint8_t);
20442__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s32_m)))
20443svint32_t svhsubr_m(svbool_t, svint32_t, svint32_t);
20444__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s64_m)))
20445svint64_t svhsubr_m(svbool_t, svint64_t, svint64_t);
20446__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s16_m)))
20447svint16_t svhsubr_m(svbool_t, svint16_t, svint16_t);
20448__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s8_x)))
20449svint8_t svhsubr_x(svbool_t, svint8_t, svint8_t);
20450__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s32_x)))
20451svint32_t svhsubr_x(svbool_t, svint32_t, svint32_t);
20452__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s64_x)))
20453svint64_t svhsubr_x(svbool_t, svint64_t, svint64_t);
20454__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s16_x)))
20455svint16_t svhsubr_x(svbool_t, svint16_t, svint16_t);
20456__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s8_z)))
20457svint8_t svhsubr_z(svbool_t, svint8_t, svint8_t);
20458__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s32_z)))
20459svint32_t svhsubr_z(svbool_t, svint32_t, svint32_t);
20460__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s64_z)))
20461svint64_t svhsubr_z(svbool_t, svint64_t, svint64_t);
20462__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s16_z)))
20463svint16_t svhsubr_z(svbool_t, svint16_t, svint16_t);
20464__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u8_m)))
20465svuint8_t svhsubr_m(svbool_t, svuint8_t, svuint8_t);
20466__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u32_m)))
20467svuint32_t svhsubr_m(svbool_t, svuint32_t, svuint32_t);
20468__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u64_m)))
20469svuint64_t svhsubr_m(svbool_t, svuint64_t, svuint64_t);
20470__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u16_m)))
20471svuint16_t svhsubr_m(svbool_t, svuint16_t, svuint16_t);
20472__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u8_x)))
20473svuint8_t svhsubr_x(svbool_t, svuint8_t, svuint8_t);
20474__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u32_x)))
20475svuint32_t svhsubr_x(svbool_t, svuint32_t, svuint32_t);
20476__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u64_x)))
20477svuint64_t svhsubr_x(svbool_t, svuint64_t, svuint64_t);
20478__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u16_x)))
20479svuint16_t svhsubr_x(svbool_t, svuint16_t, svuint16_t);
20480__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u8_z)))
20481svuint8_t svhsubr_z(svbool_t, svuint8_t, svuint8_t);
20482__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u32_z)))
20483svuint32_t svhsubr_z(svbool_t, svuint32_t, svuint32_t);
20484__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u64_z)))
20485svuint64_t svhsubr_z(svbool_t, svuint64_t, svuint64_t);
20486__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u16_z)))
20487svuint16_t svhsubr_z(svbool_t, svuint16_t, svuint16_t);
20488__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_index_u32)))
20489svuint32_t svldnt1_gather_index_u32(svbool_t, svuint32_t, int64_t);
20490__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_index_u64)))
20491svuint64_t svldnt1_gather_index_u64(svbool_t, svuint64_t, int64_t);
20492__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_index_f64)))
20493svfloat64_t svldnt1_gather_index_f64(svbool_t, svuint64_t, int64_t);
20494__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_index_f32)))
20495svfloat32_t svldnt1_gather_index_f32(svbool_t, svuint32_t, int64_t);
20496__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_index_s32)))
20497svint32_t svldnt1_gather_index_s32(svbool_t, svuint32_t, int64_t);
20498__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_index_s64)))
20499svint64_t svldnt1_gather_index_s64(svbool_t, svuint64_t, int64_t);
20500__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_offset_u32)))
20501svuint32_t svldnt1_gather_offset_u32(svbool_t, svuint32_t, int64_t);
20502__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_offset_u64)))
20503svuint64_t svldnt1_gather_offset_u64(svbool_t, svuint64_t, int64_t);
20504__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_offset_f64)))
20505svfloat64_t svldnt1_gather_offset_f64(svbool_t, svuint64_t, int64_t);
20506__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_offset_f32)))
20507svfloat32_t svldnt1_gather_offset_f32(svbool_t, svuint32_t, int64_t);
20508__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_offset_s32)))
20509svint32_t svldnt1_gather_offset_s32(svbool_t, svuint32_t, int64_t);
20510__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_offset_s64)))
20511svint64_t svldnt1_gather_offset_s64(svbool_t, svuint64_t, int64_t);
20512__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_u32)))
20513svuint32_t svldnt1_gather_u32(svbool_t, svuint32_t);
20514__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_u64)))
20515svuint64_t svldnt1_gather_u64(svbool_t, svuint64_t);
20516__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_f64)))
20517svfloat64_t svldnt1_gather_f64(svbool_t, svuint64_t);
20518__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_f32)))
20519svfloat32_t svldnt1_gather_f32(svbool_t, svuint32_t);
20520__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_s32)))
20521svint32_t svldnt1_gather_s32(svbool_t, svuint32_t);
20522__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_s64)))
20523svint64_t svldnt1_gather_s64(svbool_t, svuint64_t);
20524__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_s64index_u64)))
20525svuint64_t svldnt1_gather_index(svbool_t, uint64_t const *, svint64_t);
20526__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_s64index_f64)))
20527svfloat64_t svldnt1_gather_index(svbool_t, float64_t const *, svint64_t);
20528__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_s64index_s64)))
20529svint64_t svldnt1_gather_index(svbool_t, int64_t const *, svint64_t);
20530__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64index_u64)))
20531svuint64_t svldnt1_gather_index(svbool_t, uint64_t const *, svuint64_t);
20532__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64index_f64)))
20533svfloat64_t svldnt1_gather_index(svbool_t, float64_t const *, svuint64_t);
20534__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64index_s64)))
20535svint64_t svldnt1_gather_index(svbool_t, int64_t const *, svuint64_t);
20536__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32offset_u32)))
20537svuint32_t svldnt1_gather_offset(svbool_t, uint32_t const *, svuint32_t);
20538__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32offset_f32)))
20539svfloat32_t svldnt1_gather_offset(svbool_t, float32_t const *, svuint32_t);
20540__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32offset_s32)))
20541svint32_t svldnt1_gather_offset(svbool_t, int32_t const *, svuint32_t);
20542__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_s64offset_u64)))
20543svuint64_t svldnt1_gather_offset(svbool_t, uint64_t const *, svint64_t);
20544__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_s64offset_f64)))
20545svfloat64_t svldnt1_gather_offset(svbool_t, float64_t const *, svint64_t);
20546__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_s64offset_s64)))
20547svint64_t svldnt1_gather_offset(svbool_t, int64_t const *, svint64_t);
20548__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64offset_u64)))
20549svuint64_t svldnt1_gather_offset(svbool_t, uint64_t const *, svuint64_t);
20550__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64offset_f64)))
20551svfloat64_t svldnt1_gather_offset(svbool_t, float64_t const *, svuint64_t);
20552__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64offset_s64)))
20553svint64_t svldnt1_gather_offset(svbool_t, int64_t const *, svuint64_t);
20554__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u32base_offset_u32)))
20555svuint32_t svldnt1sb_gather_offset_u32(svbool_t, svuint32_t, int64_t);
20556__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u64base_offset_u64)))
20557svuint64_t svldnt1sb_gather_offset_u64(svbool_t, svuint64_t, int64_t);
20558__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u32base_offset_s32)))
20559svint32_t svldnt1sb_gather_offset_s32(svbool_t, svuint32_t, int64_t);
20560__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u64base_offset_s64)))
20561svint64_t svldnt1sb_gather_offset_s64(svbool_t, svuint64_t, int64_t);
20562__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u32base_u32)))
20563svuint32_t svldnt1sb_gather_u32(svbool_t, svuint32_t);
20564__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u64base_u64)))
20565svuint64_t svldnt1sb_gather_u64(svbool_t, svuint64_t);
20566__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u32base_s32)))
20567svint32_t svldnt1sb_gather_s32(svbool_t, svuint32_t);
20568__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u64base_s64)))
20569svint64_t svldnt1sb_gather_s64(svbool_t, svuint64_t);
20570__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u32offset_u32)))
20571svuint32_t svldnt1sb_gather_offset_u32(svbool_t, int8_t const *, svuint32_t);
20572__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u32offset_s32)))
20573svint32_t svldnt1sb_gather_offset_s32(svbool_t, int8_t const *, svuint32_t);
20574__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_s64offset_u64)))
20575svuint64_t svldnt1sb_gather_offset_u64(svbool_t, int8_t const *, svint64_t);
20576__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_s64offset_s64)))
20577svint64_t svldnt1sb_gather_offset_s64(svbool_t, int8_t const *, svint64_t);
20578__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u64offset_u64)))
20579svuint64_t svldnt1sb_gather_offset_u64(svbool_t, int8_t const *, svuint64_t);
20580__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u64offset_s64)))
20581svint64_t svldnt1sb_gather_offset_s64(svbool_t, int8_t const *, svuint64_t);
20582__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32base_index_u32)))
20583svuint32_t svldnt1sh_gather_index_u32(svbool_t, svuint32_t, int64_t);
20584__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64base_index_u64)))
20585svuint64_t svldnt1sh_gather_index_u64(svbool_t, svuint64_t, int64_t);
20586__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32base_index_s32)))
20587svint32_t svldnt1sh_gather_index_s32(svbool_t, svuint32_t, int64_t);
20588__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64base_index_s64)))
20589svint64_t svldnt1sh_gather_index_s64(svbool_t, svuint64_t, int64_t);
20590__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32base_offset_u32)))
20591svuint32_t svldnt1sh_gather_offset_u32(svbool_t, svuint32_t, int64_t);
20592__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64base_offset_u64)))
20593svuint64_t svldnt1sh_gather_offset_u64(svbool_t, svuint64_t, int64_t);
20594__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32base_offset_s32)))
20595svint32_t svldnt1sh_gather_offset_s32(svbool_t, svuint32_t, int64_t);
20596__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64base_offset_s64)))
20597svint64_t svldnt1sh_gather_offset_s64(svbool_t, svuint64_t, int64_t);
20598__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32base_u32)))
20599svuint32_t svldnt1sh_gather_u32(svbool_t, svuint32_t);
20600__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64base_u64)))
20601svuint64_t svldnt1sh_gather_u64(svbool_t, svuint64_t);
20602__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32base_s32)))
20603svint32_t svldnt1sh_gather_s32(svbool_t, svuint32_t);
20604__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64base_s64)))
20605svint64_t svldnt1sh_gather_s64(svbool_t, svuint64_t);
20606__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_s64index_u64)))
20607svuint64_t svldnt1sh_gather_index_u64(svbool_t, int16_t const *, svint64_t);
20608__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_s64index_s64)))
20609svint64_t svldnt1sh_gather_index_s64(svbool_t, int16_t const *, svint64_t);
20610__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64index_u64)))
20611svuint64_t svldnt1sh_gather_index_u64(svbool_t, int16_t const *, svuint64_t);
20612__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64index_s64)))
20613svint64_t svldnt1sh_gather_index_s64(svbool_t, int16_t const *, svuint64_t);
20614__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32offset_u32)))
20615svuint32_t svldnt1sh_gather_offset_u32(svbool_t, int16_t const *, svuint32_t);
20616__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32offset_s32)))
20617svint32_t svldnt1sh_gather_offset_s32(svbool_t, int16_t const *, svuint32_t);
20618__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_s64offset_u64)))
20619svuint64_t svldnt1sh_gather_offset_u64(svbool_t, int16_t const *, svint64_t);
20620__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_s64offset_s64)))
20621svint64_t svldnt1sh_gather_offset_s64(svbool_t, int16_t const *, svint64_t);
20622__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64offset_u64)))
20623svuint64_t svldnt1sh_gather_offset_u64(svbool_t, int16_t const *, svuint64_t);
20624__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64offset_s64)))
20625svint64_t svldnt1sh_gather_offset_s64(svbool_t, int16_t const *, svuint64_t);
20626__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64base_index_u64)))
20627svuint64_t svldnt1sw_gather_index_u64(svbool_t, svuint64_t, int64_t);
20628__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64base_index_s64)))
20629svint64_t svldnt1sw_gather_index_s64(svbool_t, svuint64_t, int64_t);
20630__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64base_offset_u64)))
20631svuint64_t svldnt1sw_gather_offset_u64(svbool_t, svuint64_t, int64_t);
20632__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64base_offset_s64)))
20633svint64_t svldnt1sw_gather_offset_s64(svbool_t, svuint64_t, int64_t);
20634__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64base_u64)))
20635svuint64_t svldnt1sw_gather_u64(svbool_t, svuint64_t);
20636__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64base_s64)))
20637svint64_t svldnt1sw_gather_s64(svbool_t, svuint64_t);
20638__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_s64index_u64)))
20639svuint64_t svldnt1sw_gather_index_u64(svbool_t, int32_t const *, svint64_t);
20640__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_s64index_s64)))
20641svint64_t svldnt1sw_gather_index_s64(svbool_t, int32_t const *, svint64_t);
20642__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64index_u64)))
20643svuint64_t svldnt1sw_gather_index_u64(svbool_t, int32_t const *, svuint64_t);
20644__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64index_s64)))
20645svint64_t svldnt1sw_gather_index_s64(svbool_t, int32_t const *, svuint64_t);
20646__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_s64offset_u64)))
20647svuint64_t svldnt1sw_gather_offset_u64(svbool_t, int32_t const *, svint64_t);
20648__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_s64offset_s64)))
20649svint64_t svldnt1sw_gather_offset_s64(svbool_t, int32_t const *, svint64_t);
20650__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64offset_u64)))
20651svuint64_t svldnt1sw_gather_offset_u64(svbool_t, int32_t const *, svuint64_t);
20652__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64offset_s64)))
20653svint64_t svldnt1sw_gather_offset_s64(svbool_t, int32_t const *, svuint64_t);
20654__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u32base_offset_u32)))
20655svuint32_t svldnt1ub_gather_offset_u32(svbool_t, svuint32_t, int64_t);
20656__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u64base_offset_u64)))
20657svuint64_t svldnt1ub_gather_offset_u64(svbool_t, svuint64_t, int64_t);
20658__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u32base_offset_s32)))
20659svint32_t svldnt1ub_gather_offset_s32(svbool_t, svuint32_t, int64_t);
20660__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u64base_offset_s64)))
20661svint64_t svldnt1ub_gather_offset_s64(svbool_t, svuint64_t, int64_t);
20662__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u32base_u32)))
20663svuint32_t svldnt1ub_gather_u32(svbool_t, svuint32_t);
20664__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u64base_u64)))
20665svuint64_t svldnt1ub_gather_u64(svbool_t, svuint64_t);
20666__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u32base_s32)))
20667svint32_t svldnt1ub_gather_s32(svbool_t, svuint32_t);
20668__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u64base_s64)))
20669svint64_t svldnt1ub_gather_s64(svbool_t, svuint64_t);
20670__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u32offset_u32)))
20671svuint32_t svldnt1ub_gather_offset_u32(svbool_t, uint8_t const *, svuint32_t);
20672__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u32offset_s32)))
20673svint32_t svldnt1ub_gather_offset_s32(svbool_t, uint8_t const *, svuint32_t);
20674__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_s64offset_u64)))
20675svuint64_t svldnt1ub_gather_offset_u64(svbool_t, uint8_t const *, svint64_t);
20676__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_s64offset_s64)))
20677svint64_t svldnt1ub_gather_offset_s64(svbool_t, uint8_t const *, svint64_t);
20678__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u64offset_u64)))
20679svuint64_t svldnt1ub_gather_offset_u64(svbool_t, uint8_t const *, svuint64_t);
20680__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u64offset_s64)))
20681svint64_t svldnt1ub_gather_offset_s64(svbool_t, uint8_t const *, svuint64_t);
20682__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32base_index_u32)))
20683svuint32_t svldnt1uh_gather_index_u32(svbool_t, svuint32_t, int64_t);
20684__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64base_index_u64)))
20685svuint64_t svldnt1uh_gather_index_u64(svbool_t, svuint64_t, int64_t);
20686__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32base_index_s32)))
20687svint32_t svldnt1uh_gather_index_s32(svbool_t, svuint32_t, int64_t);
20688__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64base_index_s64)))
20689svint64_t svldnt1uh_gather_index_s64(svbool_t, svuint64_t, int64_t);
20690__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32base_offset_u32)))
20691svuint32_t svldnt1uh_gather_offset_u32(svbool_t, svuint32_t, int64_t);
20692__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64base_offset_u64)))
20693svuint64_t svldnt1uh_gather_offset_u64(svbool_t, svuint64_t, int64_t);
20694__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32base_offset_s32)))
20695svint32_t svldnt1uh_gather_offset_s32(svbool_t, svuint32_t, int64_t);
20696__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64base_offset_s64)))
20697svint64_t svldnt1uh_gather_offset_s64(svbool_t, svuint64_t, int64_t);
20698__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32base_u32)))
20699svuint32_t svldnt1uh_gather_u32(svbool_t, svuint32_t);
20700__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64base_u64)))
20701svuint64_t svldnt1uh_gather_u64(svbool_t, svuint64_t);
20702__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32base_s32)))
20703svint32_t svldnt1uh_gather_s32(svbool_t, svuint32_t);
20704__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64base_s64)))
20705svint64_t svldnt1uh_gather_s64(svbool_t, svuint64_t);
20706__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_s64index_u64)))
20707svuint64_t svldnt1uh_gather_index_u64(svbool_t, uint16_t const *, svint64_t);
20708__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_s64index_s64)))
20709svint64_t svldnt1uh_gather_index_s64(svbool_t, uint16_t const *, svint64_t);
20710__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64index_u64)))
20711svuint64_t svldnt1uh_gather_index_u64(svbool_t, uint16_t const *, svuint64_t);
20712__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64index_s64)))
20713svint64_t svldnt1uh_gather_index_s64(svbool_t, uint16_t const *, svuint64_t);
20714__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32offset_u32)))
20715svuint32_t svldnt1uh_gather_offset_u32(svbool_t, uint16_t const *, svuint32_t);
20716__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32offset_s32)))
20717svint32_t svldnt1uh_gather_offset_s32(svbool_t, uint16_t const *, svuint32_t);
20718__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_s64offset_u64)))
20719svuint64_t svldnt1uh_gather_offset_u64(svbool_t, uint16_t const *, svint64_t);
20720__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_s64offset_s64)))
20721svint64_t svldnt1uh_gather_offset_s64(svbool_t, uint16_t const *, svint64_t);
20722__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64offset_u64)))
20723svuint64_t svldnt1uh_gather_offset_u64(svbool_t, uint16_t const *, svuint64_t);
20724__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64offset_s64)))
20725svint64_t svldnt1uh_gather_offset_s64(svbool_t, uint16_t const *, svuint64_t);
20726__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64base_index_u64)))
20727svuint64_t svldnt1uw_gather_index_u64(svbool_t, svuint64_t, int64_t);
20728__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64base_index_s64)))
20729svint64_t svldnt1uw_gather_index_s64(svbool_t, svuint64_t, int64_t);
20730__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64base_offset_u64)))
20731svuint64_t svldnt1uw_gather_offset_u64(svbool_t, svuint64_t, int64_t);
20732__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64base_offset_s64)))
20733svint64_t svldnt1uw_gather_offset_s64(svbool_t, svuint64_t, int64_t);
20734__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64base_u64)))
20735svuint64_t svldnt1uw_gather_u64(svbool_t, svuint64_t);
20736__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64base_s64)))
20737svint64_t svldnt1uw_gather_s64(svbool_t, svuint64_t);
20738__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_s64index_u64)))
20739svuint64_t svldnt1uw_gather_index_u64(svbool_t, uint32_t const *, svint64_t);
20740__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_s64index_s64)))
20741svint64_t svldnt1uw_gather_index_s64(svbool_t, uint32_t const *, svint64_t);
20742__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64index_u64)))
20743svuint64_t svldnt1uw_gather_index_u64(svbool_t, uint32_t const *, svuint64_t);
20744__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64index_s64)))
20745svint64_t svldnt1uw_gather_index_s64(svbool_t, uint32_t const *, svuint64_t);
20746__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_s64offset_u64)))
20747svuint64_t svldnt1uw_gather_offset_u64(svbool_t, uint32_t const *, svint64_t);
20748__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_s64offset_s64)))
20749svint64_t svldnt1uw_gather_offset_s64(svbool_t, uint32_t const *, svint64_t);
20750__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64offset_u64)))
20751svuint64_t svldnt1uw_gather_offset_u64(svbool_t, uint32_t const *, svuint64_t);
20752__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64offset_s64)))
20753svint64_t svldnt1uw_gather_offset_s64(svbool_t, uint32_t const *, svuint64_t);
20754__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f64_m)))
20755svint64_t svlogb_m(svint64_t, svbool_t, svfloat64_t);
20756__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f32_m)))
20757svint32_t svlogb_m(svint32_t, svbool_t, svfloat32_t);
20758__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f16_m)))
20759svint16_t svlogb_m(svint16_t, svbool_t, svfloat16_t);
20760__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f64_x)))
20761svint64_t svlogb_x(svbool_t, svfloat64_t);
20762__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f32_x)))
20763svint32_t svlogb_x(svbool_t, svfloat32_t);
20764__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f16_x)))
20765svint16_t svlogb_x(svbool_t, svfloat16_t);
20766__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f64_z)))
20767svint64_t svlogb_z(svbool_t, svfloat64_t);
20768__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f32_z)))
20769svint32_t svlogb_z(svbool_t, svfloat32_t);
20770__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f16_z)))
20771svint16_t svlogb_z(svbool_t, svfloat16_t);
20772__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmatch_u8)))
20773svbool_t svmatch(svbool_t, svuint8_t, svuint8_t);
20774__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmatch_u16)))
20775svbool_t svmatch(svbool_t, svuint16_t, svuint16_t);
20776__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmatch_s8)))
20777svbool_t svmatch(svbool_t, svint8_t, svint8_t);
20778__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmatch_s16)))
20779svbool_t svmatch(svbool_t, svint16_t, svint16_t);
20780__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxnmp_f64_m)))
20781svfloat64_t svmaxnmp_m(svbool_t, svfloat64_t, svfloat64_t);
20782__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxnmp_f32_m)))
20783svfloat32_t svmaxnmp_m(svbool_t, svfloat32_t, svfloat32_t);
20784__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxnmp_f16_m)))
20785svfloat16_t svmaxnmp_m(svbool_t, svfloat16_t, svfloat16_t);
20786__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxnmp_f64_x)))
20787svfloat64_t svmaxnmp_x(svbool_t, svfloat64_t, svfloat64_t);
20788__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxnmp_f32_x)))
20789svfloat32_t svmaxnmp_x(svbool_t, svfloat32_t, svfloat32_t);
20790__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxnmp_f16_x)))
20791svfloat16_t svmaxnmp_x(svbool_t, svfloat16_t, svfloat16_t);
20792__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_f64_m)))
20793svfloat64_t svmaxp_m(svbool_t, svfloat64_t, svfloat64_t);
20794__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_f32_m)))
20795svfloat32_t svmaxp_m(svbool_t, svfloat32_t, svfloat32_t);
20796__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_f16_m)))
20797svfloat16_t svmaxp_m(svbool_t, svfloat16_t, svfloat16_t);
20798__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_f64_x)))
20799svfloat64_t svmaxp_x(svbool_t, svfloat64_t, svfloat64_t);
20800__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_f32_x)))
20801svfloat32_t svmaxp_x(svbool_t, svfloat32_t, svfloat32_t);
20802__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_f16_x)))
20803svfloat16_t svmaxp_x(svbool_t, svfloat16_t, svfloat16_t);
20804__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s8_m)))
20805svint8_t svmaxp_m(svbool_t, svint8_t, svint8_t);
20806__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s32_m)))
20807svint32_t svmaxp_m(svbool_t, svint32_t, svint32_t);
20808__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s64_m)))
20809svint64_t svmaxp_m(svbool_t, svint64_t, svint64_t);
20810__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s16_m)))
20811svint16_t svmaxp_m(svbool_t, svint16_t, svint16_t);
20812__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s8_x)))
20813svint8_t svmaxp_x(svbool_t, svint8_t, svint8_t);
20814__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s32_x)))
20815svint32_t svmaxp_x(svbool_t, svint32_t, svint32_t);
20816__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s64_x)))
20817svint64_t svmaxp_x(svbool_t, svint64_t, svint64_t);
20818__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s16_x)))
20819svint16_t svmaxp_x(svbool_t, svint16_t, svint16_t);
20820__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u8_m)))
20821svuint8_t svmaxp_m(svbool_t, svuint8_t, svuint8_t);
20822__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u32_m)))
20823svuint32_t svmaxp_m(svbool_t, svuint32_t, svuint32_t);
20824__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u64_m)))
20825svuint64_t svmaxp_m(svbool_t, svuint64_t, svuint64_t);
20826__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u16_m)))
20827svuint16_t svmaxp_m(svbool_t, svuint16_t, svuint16_t);
20828__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u8_x)))
20829svuint8_t svmaxp_x(svbool_t, svuint8_t, svuint8_t);
20830__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u32_x)))
20831svuint32_t svmaxp_x(svbool_t, svuint32_t, svuint32_t);
20832__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u64_x)))
20833svuint64_t svmaxp_x(svbool_t, svuint64_t, svuint64_t);
20834__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u16_x)))
20835svuint16_t svmaxp_x(svbool_t, svuint16_t, svuint16_t);
20836__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminnmp_f64_m)))
20837svfloat64_t svminnmp_m(svbool_t, svfloat64_t, svfloat64_t);
20838__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminnmp_f32_m)))
20839svfloat32_t svminnmp_m(svbool_t, svfloat32_t, svfloat32_t);
20840__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminnmp_f16_m)))
20841svfloat16_t svminnmp_m(svbool_t, svfloat16_t, svfloat16_t);
20842__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminnmp_f64_x)))
20843svfloat64_t svminnmp_x(svbool_t, svfloat64_t, svfloat64_t);
20844__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminnmp_f32_x)))
20845svfloat32_t svminnmp_x(svbool_t, svfloat32_t, svfloat32_t);
20846__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminnmp_f16_x)))
20847svfloat16_t svminnmp_x(svbool_t, svfloat16_t, svfloat16_t);
20848__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_f64_m)))
20849svfloat64_t svminp_m(svbool_t, svfloat64_t, svfloat64_t);
20850__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_f32_m)))
20851svfloat32_t svminp_m(svbool_t, svfloat32_t, svfloat32_t);
20852__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_f16_m)))
20853svfloat16_t svminp_m(svbool_t, svfloat16_t, svfloat16_t);
20854__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_f64_x)))
20855svfloat64_t svminp_x(svbool_t, svfloat64_t, svfloat64_t);
20856__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_f32_x)))
20857svfloat32_t svminp_x(svbool_t, svfloat32_t, svfloat32_t);
20858__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_f16_x)))
20859svfloat16_t svminp_x(svbool_t, svfloat16_t, svfloat16_t);
20860__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s8_m)))
20861svint8_t svminp_m(svbool_t, svint8_t, svint8_t);
20862__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s32_m)))
20863svint32_t svminp_m(svbool_t, svint32_t, svint32_t);
20864__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s64_m)))
20865svint64_t svminp_m(svbool_t, svint64_t, svint64_t);
20866__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s16_m)))
20867svint16_t svminp_m(svbool_t, svint16_t, svint16_t);
20868__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s8_x)))
20869svint8_t svminp_x(svbool_t, svint8_t, svint8_t);
20870__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s32_x)))
20871svint32_t svminp_x(svbool_t, svint32_t, svint32_t);
20872__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s64_x)))
20873svint64_t svminp_x(svbool_t, svint64_t, svint64_t);
20874__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s16_x)))
20875svint16_t svminp_x(svbool_t, svint16_t, svint16_t);
20876__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u8_m)))
20877svuint8_t svminp_m(svbool_t, svuint8_t, svuint8_t);
20878__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u32_m)))
20879svuint32_t svminp_m(svbool_t, svuint32_t, svuint32_t);
20880__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u64_m)))
20881svuint64_t svminp_m(svbool_t, svuint64_t, svuint64_t);
20882__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u16_m)))
20883svuint16_t svminp_m(svbool_t, svuint16_t, svuint16_t);
20884__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u8_x)))
20885svuint8_t svminp_x(svbool_t, svuint8_t, svuint8_t);
20886__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u32_x)))
20887svuint32_t svminp_x(svbool_t, svuint32_t, svuint32_t);
20888__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u64_x)))
20889svuint64_t svminp_x(svbool_t, svuint64_t, svuint64_t);
20890__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u16_x)))
20891svuint16_t svminp_x(svbool_t, svuint16_t, svuint16_t);
20892__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmla_lane_u32)))
20893svuint32_t svmla_lane(svuint32_t, svuint32_t, svuint32_t, uint64_t);
20894__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmla_lane_u64)))
20895svuint64_t svmla_lane(svuint64_t, svuint64_t, svuint64_t, uint64_t);
20896__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmla_lane_u16)))
20897svuint16_t svmla_lane(svuint16_t, svuint16_t, svuint16_t, uint64_t);
20898__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmla_lane_s32)))
20899svint32_t svmla_lane(svint32_t, svint32_t, svint32_t, uint64_t);
20900__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmla_lane_s64)))
20901svint64_t svmla_lane(svint64_t, svint64_t, svint64_t, uint64_t);
20902__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmla_lane_s16)))
20903svint16_t svmla_lane(svint16_t, svint16_t, svint16_t, uint64_t);
20904__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_n_f32)))
20905svfloat32_t svmlalb(svfloat32_t, svfloat16_t, float16_t);
20906__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_n_s32)))
20907svint32_t svmlalb(svint32_t, svint16_t, int16_t);
20908__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_n_s64)))
20909svint64_t svmlalb(svint64_t, svint32_t, int32_t);
20910__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_n_s16)))
20911svint16_t svmlalb(svint16_t, svint8_t, int8_t);
20912__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_n_u32)))
20913svuint32_t svmlalb(svuint32_t, svuint16_t, uint16_t);
20914__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_n_u64)))
20915svuint64_t svmlalb(svuint64_t, svuint32_t, uint32_t);
20916__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_n_u16)))
20917svuint16_t svmlalb(svuint16_t, svuint8_t, uint8_t);
20918__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_f32)))
20919svfloat32_t svmlalb(svfloat32_t, svfloat16_t, svfloat16_t);
20920__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_s32)))
20921svint32_t svmlalb(svint32_t, svint16_t, svint16_t);
20922__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_s64)))
20923svint64_t svmlalb(svint64_t, svint32_t, svint32_t);
20924__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_s16)))
20925svint16_t svmlalb(svint16_t, svint8_t, svint8_t);
20926__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_u32)))
20927svuint32_t svmlalb(svuint32_t, svuint16_t, svuint16_t);
20928__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_u64)))
20929svuint64_t svmlalb(svuint64_t, svuint32_t, svuint32_t);
20930__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_u16)))
20931svuint16_t svmlalb(svuint16_t, svuint8_t, svuint8_t);
20932__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_lane_f32)))
20933svfloat32_t svmlalb_lane(svfloat32_t, svfloat16_t, svfloat16_t, uint64_t);
20934__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_lane_s32)))
20935svint32_t svmlalb_lane(svint32_t, svint16_t, svint16_t, uint64_t);
20936__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_lane_s64)))
20937svint64_t svmlalb_lane(svint64_t, svint32_t, svint32_t, uint64_t);
20938__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_lane_u32)))
20939svuint32_t svmlalb_lane(svuint32_t, svuint16_t, svuint16_t, uint64_t);
20940__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_lane_u64)))
20941svuint64_t svmlalb_lane(svuint64_t, svuint32_t, svuint32_t, uint64_t);
20942__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_n_f32)))
20943svfloat32_t svmlalt(svfloat32_t, svfloat16_t, float16_t);
20944__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_n_s32)))
20945svint32_t svmlalt(svint32_t, svint16_t, int16_t);
20946__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_n_s64)))
20947svint64_t svmlalt(svint64_t, svint32_t, int32_t);
20948__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_n_s16)))
20949svint16_t svmlalt(svint16_t, svint8_t, int8_t);
20950__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_n_u32)))
20951svuint32_t svmlalt(svuint32_t, svuint16_t, uint16_t);
20952__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_n_u64)))
20953svuint64_t svmlalt(svuint64_t, svuint32_t, uint32_t);
20954__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_n_u16)))
20955svuint16_t svmlalt(svuint16_t, svuint8_t, uint8_t);
20956__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_f32)))
20957svfloat32_t svmlalt(svfloat32_t, svfloat16_t, svfloat16_t);
20958__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_s32)))
20959svint32_t svmlalt(svint32_t, svint16_t, svint16_t);
20960__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_s64)))
20961svint64_t svmlalt(svint64_t, svint32_t, svint32_t);
20962__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_s16)))
20963svint16_t svmlalt(svint16_t, svint8_t, svint8_t);
20964__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_u32)))
20965svuint32_t svmlalt(svuint32_t, svuint16_t, svuint16_t);
20966__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_u64)))
20967svuint64_t svmlalt(svuint64_t, svuint32_t, svuint32_t);
20968__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_u16)))
20969svuint16_t svmlalt(svuint16_t, svuint8_t, svuint8_t);
20970__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_lane_f32)))
20971svfloat32_t svmlalt_lane(svfloat32_t, svfloat16_t, svfloat16_t, uint64_t);
20972__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_lane_s32)))
20973svint32_t svmlalt_lane(svint32_t, svint16_t, svint16_t, uint64_t);
20974__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_lane_s64)))
20975svint64_t svmlalt_lane(svint64_t, svint32_t, svint32_t, uint64_t);
20976__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_lane_u32)))
20977svuint32_t svmlalt_lane(svuint32_t, svuint16_t, svuint16_t, uint64_t);
20978__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_lane_u64)))
20979svuint64_t svmlalt_lane(svuint64_t, svuint32_t, svuint32_t, uint64_t);
20980__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmls_lane_u32)))
20981svuint32_t svmls_lane(svuint32_t, svuint32_t, svuint32_t, uint64_t);
20982__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmls_lane_u64)))
20983svuint64_t svmls_lane(svuint64_t, svuint64_t, svuint64_t, uint64_t);
20984__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmls_lane_u16)))
20985svuint16_t svmls_lane(svuint16_t, svuint16_t, svuint16_t, uint64_t);
20986__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmls_lane_s32)))
20987svint32_t svmls_lane(svint32_t, svint32_t, svint32_t, uint64_t);
20988__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmls_lane_s64)))
20989svint64_t svmls_lane(svint64_t, svint64_t, svint64_t, uint64_t);
20990__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmls_lane_s16)))
20991svint16_t svmls_lane(svint16_t, svint16_t, svint16_t, uint64_t);
20992__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_n_f32)))
20993svfloat32_t svmlslb(svfloat32_t, svfloat16_t, float16_t);
20994__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_n_s32)))
20995svint32_t svmlslb(svint32_t, svint16_t, int16_t);
20996__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_n_s64)))
20997svint64_t svmlslb(svint64_t, svint32_t, int32_t);
20998__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_n_s16)))
20999svint16_t svmlslb(svint16_t, svint8_t, int8_t);
21000__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_n_u32)))
21001svuint32_t svmlslb(svuint32_t, svuint16_t, uint16_t);
21002__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_n_u64)))
21003svuint64_t svmlslb(svuint64_t, svuint32_t, uint32_t);
21004__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_n_u16)))
21005svuint16_t svmlslb(svuint16_t, svuint8_t, uint8_t);
21006__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_f32)))
21007svfloat32_t svmlslb(svfloat32_t, svfloat16_t, svfloat16_t);
21008__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_s32)))
21009svint32_t svmlslb(svint32_t, svint16_t, svint16_t);
21010__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_s64)))
21011svint64_t svmlslb(svint64_t, svint32_t, svint32_t);
21012__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_s16)))
21013svint16_t svmlslb(svint16_t, svint8_t, svint8_t);
21014__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_u32)))
21015svuint32_t svmlslb(svuint32_t, svuint16_t, svuint16_t);
21016__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_u64)))
21017svuint64_t svmlslb(svuint64_t, svuint32_t, svuint32_t);
21018__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_u16)))
21019svuint16_t svmlslb(svuint16_t, svuint8_t, svuint8_t);
21020__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_lane_f32)))
21021svfloat32_t svmlslb_lane(svfloat32_t, svfloat16_t, svfloat16_t, uint64_t);
21022__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_lane_s32)))
21023svint32_t svmlslb_lane(svint32_t, svint16_t, svint16_t, uint64_t);
21024__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_lane_s64)))
21025svint64_t svmlslb_lane(svint64_t, svint32_t, svint32_t, uint64_t);
21026__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_lane_u32)))
21027svuint32_t svmlslb_lane(svuint32_t, svuint16_t, svuint16_t, uint64_t);
21028__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_lane_u64)))
21029svuint64_t svmlslb_lane(svuint64_t, svuint32_t, svuint32_t, uint64_t);
21030__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_n_f32)))
21031svfloat32_t svmlslt(svfloat32_t, svfloat16_t, float16_t);
21032__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_n_s32)))
21033svint32_t svmlslt(svint32_t, svint16_t, int16_t);
21034__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_n_s64)))
21035svint64_t svmlslt(svint64_t, svint32_t, int32_t);
21036__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_n_s16)))
21037svint16_t svmlslt(svint16_t, svint8_t, int8_t);
21038__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_n_u32)))
21039svuint32_t svmlslt(svuint32_t, svuint16_t, uint16_t);
21040__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_n_u64)))
21041svuint64_t svmlslt(svuint64_t, svuint32_t, uint32_t);
21042__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_n_u16)))
21043svuint16_t svmlslt(svuint16_t, svuint8_t, uint8_t);
21044__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_f32)))
21045svfloat32_t svmlslt(svfloat32_t, svfloat16_t, svfloat16_t);
21046__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_s32)))
21047svint32_t svmlslt(svint32_t, svint16_t, svint16_t);
21048__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_s64)))
21049svint64_t svmlslt(svint64_t, svint32_t, svint32_t);
21050__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_s16)))
21051svint16_t svmlslt(svint16_t, svint8_t, svint8_t);
21052__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_u32)))
21053svuint32_t svmlslt(svuint32_t, svuint16_t, svuint16_t);
21054__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_u64)))
21055svuint64_t svmlslt(svuint64_t, svuint32_t, svuint32_t);
21056__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_u16)))
21057svuint16_t svmlslt(svuint16_t, svuint8_t, svuint8_t);
21058__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_lane_f32)))
21059svfloat32_t svmlslt_lane(svfloat32_t, svfloat16_t, svfloat16_t, uint64_t);
21060__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_lane_s32)))
21061svint32_t svmlslt_lane(svint32_t, svint16_t, svint16_t, uint64_t);
21062__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_lane_s64)))
21063svint64_t svmlslt_lane(svint64_t, svint32_t, svint32_t, uint64_t);
21064__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_lane_u32)))
21065svuint32_t svmlslt_lane(svuint32_t, svuint16_t, svuint16_t, uint64_t);
21066__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_lane_u64)))
21067svuint64_t svmlslt_lane(svuint64_t, svuint32_t, svuint32_t, uint64_t);
21068__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlb_s32)))
21069svint32_t svmovlb(svint16_t);
21070__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlb_s64)))
21071svint64_t svmovlb(svint32_t);
21072__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlb_s16)))
21073svint16_t svmovlb(svint8_t);
21074__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlb_u32)))
21075svuint32_t svmovlb(svuint16_t);
21076__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlb_u64)))
21077svuint64_t svmovlb(svuint32_t);
21078__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlb_u16)))
21079svuint16_t svmovlb(svuint8_t);
21080__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlt_s32)))
21081svint32_t svmovlt(svint16_t);
21082__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlt_s64)))
21083svint64_t svmovlt(svint32_t);
21084__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlt_s16)))
21085svint16_t svmovlt(svint8_t);
21086__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlt_u32)))
21087svuint32_t svmovlt(svuint16_t);
21088__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlt_u64)))
21089svuint64_t svmovlt(svuint32_t);
21090__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlt_u16)))
21091svuint16_t svmovlt(svuint8_t);
21092__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmul_lane_u32)))
21093svuint32_t svmul_lane(svuint32_t, svuint32_t, uint64_t);
21094__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmul_lane_u64)))
21095svuint64_t svmul_lane(svuint64_t, svuint64_t, uint64_t);
21096__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmul_lane_u16)))
21097svuint16_t svmul_lane(svuint16_t, svuint16_t, uint64_t);
21098__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmul_lane_s32)))
21099svint32_t svmul_lane(svint32_t, svint32_t, uint64_t);
21100__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmul_lane_s64)))
21101svint64_t svmul_lane(svint64_t, svint64_t, uint64_t);
21102__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmul_lane_s16)))
21103svint16_t svmul_lane(svint16_t, svint16_t, uint64_t);
21104__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_n_s32)))
21105svint32_t svmullb(svint16_t, int16_t);
21106__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_n_s64)))
21107svint64_t svmullb(svint32_t, int32_t);
21108__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_n_s16)))
21109svint16_t svmullb(svint8_t, int8_t);
21110__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_n_u32)))
21111svuint32_t svmullb(svuint16_t, uint16_t);
21112__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_n_u64)))
21113svuint64_t svmullb(svuint32_t, uint32_t);
21114__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_n_u16)))
21115svuint16_t svmullb(svuint8_t, uint8_t);
21116__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_s32)))
21117svint32_t svmullb(svint16_t, svint16_t);
21118__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_s64)))
21119svint64_t svmullb(svint32_t, svint32_t);
21120__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_s16)))
21121svint16_t svmullb(svint8_t, svint8_t);
21122__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_u32)))
21123svuint32_t svmullb(svuint16_t, svuint16_t);
21124__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_u64)))
21125svuint64_t svmullb(svuint32_t, svuint32_t);
21126__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_u16)))
21127svuint16_t svmullb(svuint8_t, svuint8_t);
21128__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_lane_s32)))
21129svint32_t svmullb_lane(svint16_t, svint16_t, uint64_t);
21130__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_lane_s64)))
21131svint64_t svmullb_lane(svint32_t, svint32_t, uint64_t);
21132__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_lane_u32)))
21133svuint32_t svmullb_lane(svuint16_t, svuint16_t, uint64_t);
21134__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_lane_u64)))
21135svuint64_t svmullb_lane(svuint32_t, svuint32_t, uint64_t);
21136__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_n_s32)))
21137svint32_t svmullt(svint16_t, int16_t);
21138__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_n_s64)))
21139svint64_t svmullt(svint32_t, int32_t);
21140__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_n_s16)))
21141svint16_t svmullt(svint8_t, int8_t);
21142__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_n_u32)))
21143svuint32_t svmullt(svuint16_t, uint16_t);
21144__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_n_u64)))
21145svuint64_t svmullt(svuint32_t, uint32_t);
21146__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_n_u16)))
21147svuint16_t svmullt(svuint8_t, uint8_t);
21148__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_s32)))
21149svint32_t svmullt(svint16_t, svint16_t);
21150__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_s64)))
21151svint64_t svmullt(svint32_t, svint32_t);
21152__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_s16)))
21153svint16_t svmullt(svint8_t, svint8_t);
21154__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_u32)))
21155svuint32_t svmullt(svuint16_t, svuint16_t);
21156__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_u64)))
21157svuint64_t svmullt(svuint32_t, svuint32_t);
21158__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_u16)))
21159svuint16_t svmullt(svuint8_t, svuint8_t);
21160__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_lane_s32)))
21161svint32_t svmullt_lane(svint16_t, svint16_t, uint64_t);
21162__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_lane_s64)))
21163svint64_t svmullt_lane(svint32_t, svint32_t, uint64_t);
21164__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_lane_u32)))
21165svuint32_t svmullt_lane(svuint16_t, svuint16_t, uint64_t);
21166__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_lane_u64)))
21167svuint64_t svmullt_lane(svuint32_t, svuint32_t, uint64_t);
21168__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_u8)))
21169svuint8_t svnbsl(svuint8_t, svuint8_t, uint8_t);
21170__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_u32)))
21171svuint32_t svnbsl(svuint32_t, svuint32_t, uint32_t);
21172__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_u64)))
21173svuint64_t svnbsl(svuint64_t, svuint64_t, uint64_t);
21174__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_u16)))
21175svuint16_t svnbsl(svuint16_t, svuint16_t, uint16_t);
21176__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_s8)))
21177svint8_t svnbsl(svint8_t, svint8_t, int8_t);
21178__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_s32)))
21179svint32_t svnbsl(svint32_t, svint32_t, int32_t);
21180__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_s64)))
21181svint64_t svnbsl(svint64_t, svint64_t, int64_t);
21182__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_s16)))
21183svint16_t svnbsl(svint16_t, svint16_t, int16_t);
21184__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_u8)))
21185svuint8_t svnbsl(svuint8_t, svuint8_t, svuint8_t);
21186__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_u32)))
21187svuint32_t svnbsl(svuint32_t, svuint32_t, svuint32_t);
21188__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_u64)))
21189svuint64_t svnbsl(svuint64_t, svuint64_t, svuint64_t);
21190__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_u16)))
21191svuint16_t svnbsl(svuint16_t, svuint16_t, svuint16_t);
21192__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_s8)))
21193svint8_t svnbsl(svint8_t, svint8_t, svint8_t);
21194__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_s32)))
21195svint32_t svnbsl(svint32_t, svint32_t, svint32_t);
21196__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_s64)))
21197svint64_t svnbsl(svint64_t, svint64_t, svint64_t);
21198__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_s16)))
21199svint16_t svnbsl(svint16_t, svint16_t, svint16_t);
21200__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnmatch_u8)))
21201svbool_t svnmatch(svbool_t, svuint8_t, svuint8_t);
21202__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnmatch_u16)))
21203svbool_t svnmatch(svbool_t, svuint16_t, svuint16_t);
21204__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnmatch_s8)))
21205svbool_t svnmatch(svbool_t, svint8_t, svint8_t);
21206__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnmatch_s16)))
21207svbool_t svnmatch(svbool_t, svint16_t, svint16_t);
21208__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmul_n_u8)))
21209svuint8_t svpmul(svuint8_t, uint8_t);
21210__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmul_u8)))
21211svuint8_t svpmul(svuint8_t, svuint8_t);
21212__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_n_u64)))
21213svuint64_t svpmullb(svuint32_t, uint32_t);
21214__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_n_u16)))
21215svuint16_t svpmullb(svuint8_t, uint8_t);
21216__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_u64)))
21217svuint64_t svpmullb(svuint32_t, svuint32_t);
21218__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_u16)))
21219svuint16_t svpmullb(svuint8_t, svuint8_t);
21220__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_pair_n_u8)))
21221svuint8_t svpmullb_pair(svuint8_t, uint8_t);
21222__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_pair_n_u32)))
21223svuint32_t svpmullb_pair(svuint32_t, uint32_t);
21224__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_pair_u8)))
21225svuint8_t svpmullb_pair(svuint8_t, svuint8_t);
21226__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_pair_u32)))
21227svuint32_t svpmullb_pair(svuint32_t, svuint32_t);
21228__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_n_u64)))
21229svuint64_t svpmullt(svuint32_t, uint32_t);
21230__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_n_u16)))
21231svuint16_t svpmullt(svuint8_t, uint8_t);
21232__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_u64)))
21233svuint64_t svpmullt(svuint32_t, svuint32_t);
21234__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_u16)))
21235svuint16_t svpmullt(svuint8_t, svuint8_t);
21236__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_pair_n_u8)))
21237svuint8_t svpmullt_pair(svuint8_t, uint8_t);
21238__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_pair_n_u32)))
21239svuint32_t svpmullt_pair(svuint32_t, uint32_t);
21240__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_pair_u8)))
21241svuint8_t svpmullt_pair(svuint8_t, svuint8_t);
21242__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_pair_u32)))
21243svuint32_t svpmullt_pair(svuint32_t, svuint32_t);
21244__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s8_m)))
21245svint8_t svqabs_m(svint8_t, svbool_t, svint8_t);
21246__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s32_m)))
21247svint32_t svqabs_m(svint32_t, svbool_t, svint32_t);
21248__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s64_m)))
21249svint64_t svqabs_m(svint64_t, svbool_t, svint64_t);
21250__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s16_m)))
21251svint16_t svqabs_m(svint16_t, svbool_t, svint16_t);
21252__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s8_x)))
21253svint8_t svqabs_x(svbool_t, svint8_t);
21254__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s32_x)))
21255svint32_t svqabs_x(svbool_t, svint32_t);
21256__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s64_x)))
21257svint64_t svqabs_x(svbool_t, svint64_t);
21258__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s16_x)))
21259svint16_t svqabs_x(svbool_t, svint16_t);
21260__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s8_z)))
21261svint8_t svqabs_z(svbool_t, svint8_t);
21262__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s32_z)))
21263svint32_t svqabs_z(svbool_t, svint32_t);
21264__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s64_z)))
21265svint64_t svqabs_z(svbool_t, svint64_t);
21266__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s16_z)))
21267svint16_t svqabs_z(svbool_t, svint16_t);
21268__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s8_m)))
21269svint8_t svqadd_m(svbool_t, svint8_t, int8_t);
21270__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s32_m)))
21271svint32_t svqadd_m(svbool_t, svint32_t, int32_t);
21272__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s64_m)))
21273svint64_t svqadd_m(svbool_t, svint64_t, int64_t);
21274__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s16_m)))
21275svint16_t svqadd_m(svbool_t, svint16_t, int16_t);
21276__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s8_x)))
21277svint8_t svqadd_x(svbool_t, svint8_t, int8_t);
21278__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s32_x)))
21279svint32_t svqadd_x(svbool_t, svint32_t, int32_t);
21280__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s64_x)))
21281svint64_t svqadd_x(svbool_t, svint64_t, int64_t);
21282__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s16_x)))
21283svint16_t svqadd_x(svbool_t, svint16_t, int16_t);
21284__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s8_z)))
21285svint8_t svqadd_z(svbool_t, svint8_t, int8_t);
21286__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s32_z)))
21287svint32_t svqadd_z(svbool_t, svint32_t, int32_t);
21288__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s64_z)))
21289svint64_t svqadd_z(svbool_t, svint64_t, int64_t);
21290__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s16_z)))
21291svint16_t svqadd_z(svbool_t, svint16_t, int16_t);
21292__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u8_m)))
21293svuint8_t svqadd_m(svbool_t, svuint8_t, uint8_t);
21294__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u32_m)))
21295svuint32_t svqadd_m(svbool_t, svuint32_t, uint32_t);
21296__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u64_m)))
21297svuint64_t svqadd_m(svbool_t, svuint64_t, uint64_t);
21298__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u16_m)))
21299svuint16_t svqadd_m(svbool_t, svuint16_t, uint16_t);
21300__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u8_x)))
21301svuint8_t svqadd_x(svbool_t, svuint8_t, uint8_t);
21302__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u32_x)))
21303svuint32_t svqadd_x(svbool_t, svuint32_t, uint32_t);
21304__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u64_x)))
21305svuint64_t svqadd_x(svbool_t, svuint64_t, uint64_t);
21306__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u16_x)))
21307svuint16_t svqadd_x(svbool_t, svuint16_t, uint16_t);
21308__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u8_z)))
21309svuint8_t svqadd_z(svbool_t, svuint8_t, uint8_t);
21310__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u32_z)))
21311svuint32_t svqadd_z(svbool_t, svuint32_t, uint32_t);
21312__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u64_z)))
21313svuint64_t svqadd_z(svbool_t, svuint64_t, uint64_t);
21314__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u16_z)))
21315svuint16_t svqadd_z(svbool_t, svuint16_t, uint16_t);
21316__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s8_m)))
21317svint8_t svqadd_m(svbool_t, svint8_t, svint8_t);
21318__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s32_m)))
21319svint32_t svqadd_m(svbool_t, svint32_t, svint32_t);
21320__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s64_m)))
21321svint64_t svqadd_m(svbool_t, svint64_t, svint64_t);
21322__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s16_m)))
21323svint16_t svqadd_m(svbool_t, svint16_t, svint16_t);
21324__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s8_x)))
21325svint8_t svqadd_x(svbool_t, svint8_t, svint8_t);
21326__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s32_x)))
21327svint32_t svqadd_x(svbool_t, svint32_t, svint32_t);
21328__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s64_x)))
21329svint64_t svqadd_x(svbool_t, svint64_t, svint64_t);
21330__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s16_x)))
21331svint16_t svqadd_x(svbool_t, svint16_t, svint16_t);
21332__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s8_z)))
21333svint8_t svqadd_z(svbool_t, svint8_t, svint8_t);
21334__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s32_z)))
21335svint32_t svqadd_z(svbool_t, svint32_t, svint32_t);
21336__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s64_z)))
21337svint64_t svqadd_z(svbool_t, svint64_t, svint64_t);
21338__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s16_z)))
21339svint16_t svqadd_z(svbool_t, svint16_t, svint16_t);
21340__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u8_m)))
21341svuint8_t svqadd_m(svbool_t, svuint8_t, svuint8_t);
21342__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u32_m)))
21343svuint32_t svqadd_m(svbool_t, svuint32_t, svuint32_t);
21344__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u64_m)))
21345svuint64_t svqadd_m(svbool_t, svuint64_t, svuint64_t);
21346__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u16_m)))
21347svuint16_t svqadd_m(svbool_t, svuint16_t, svuint16_t);
21348__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u8_x)))
21349svuint8_t svqadd_x(svbool_t, svuint8_t, svuint8_t);
21350__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u32_x)))
21351svuint32_t svqadd_x(svbool_t, svuint32_t, svuint32_t);
21352__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u64_x)))
21353svuint64_t svqadd_x(svbool_t, svuint64_t, svuint64_t);
21354__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u16_x)))
21355svuint16_t svqadd_x(svbool_t, svuint16_t, svuint16_t);
21356__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u8_z)))
21357svuint8_t svqadd_z(svbool_t, svuint8_t, svuint8_t);
21358__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u32_z)))
21359svuint32_t svqadd_z(svbool_t, svuint32_t, svuint32_t);
21360__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u64_z)))
21361svuint64_t svqadd_z(svbool_t, svuint64_t, svuint64_t);
21362__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u16_z)))
21363svuint16_t svqadd_z(svbool_t, svuint16_t, svuint16_t);
21364__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqcadd_s8)))
21365svint8_t svqcadd(svint8_t, svint8_t, uint64_t);
21366__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqcadd_s32)))
21367svint32_t svqcadd(svint32_t, svint32_t, uint64_t);
21368__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqcadd_s64)))
21369svint64_t svqcadd(svint64_t, svint64_t, uint64_t);
21370__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqcadd_s16)))
21371svint16_t svqcadd(svint16_t, svint16_t, uint64_t);
21372__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_n_s32)))
21373svint32_t svqdmlalb(svint32_t, svint16_t, int16_t);
21374__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_n_s64)))
21375svint64_t svqdmlalb(svint64_t, svint32_t, int32_t);
21376__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_n_s16)))
21377svint16_t svqdmlalb(svint16_t, svint8_t, int8_t);
21378__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_s32)))
21379svint32_t svqdmlalb(svint32_t, svint16_t, svint16_t);
21380__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_s64)))
21381svint64_t svqdmlalb(svint64_t, svint32_t, svint32_t);
21382__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_s16)))
21383svint16_t svqdmlalb(svint16_t, svint8_t, svint8_t);
21384__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_lane_s32)))
21385svint32_t svqdmlalb_lane(svint32_t, svint16_t, svint16_t, uint64_t);
21386__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_lane_s64)))
21387svint64_t svqdmlalb_lane(svint64_t, svint32_t, svint32_t, uint64_t);
21388__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalbt_n_s32)))
21389svint32_t svqdmlalbt(svint32_t, svint16_t, int16_t);
21390__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalbt_n_s64)))
21391svint64_t svqdmlalbt(svint64_t, svint32_t, int32_t);
21392__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalbt_n_s16)))
21393svint16_t svqdmlalbt(svint16_t, svint8_t, int8_t);
21394__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalbt_s32)))
21395svint32_t svqdmlalbt(svint32_t, svint16_t, svint16_t);
21396__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalbt_s64)))
21397svint64_t svqdmlalbt(svint64_t, svint32_t, svint32_t);
21398__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalbt_s16)))
21399svint16_t svqdmlalbt(svint16_t, svint8_t, svint8_t);
21400__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_n_s32)))
21401svint32_t svqdmlalt(svint32_t, svint16_t, int16_t);
21402__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_n_s64)))
21403svint64_t svqdmlalt(svint64_t, svint32_t, int32_t);
21404__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_n_s16)))
21405svint16_t svqdmlalt(svint16_t, svint8_t, int8_t);
21406__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_s32)))
21407svint32_t svqdmlalt(svint32_t, svint16_t, svint16_t);
21408__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_s64)))
21409svint64_t svqdmlalt(svint64_t, svint32_t, svint32_t);
21410__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_s16)))
21411svint16_t svqdmlalt(svint16_t, svint8_t, svint8_t);
21412__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_lane_s32)))
21413svint32_t svqdmlalt_lane(svint32_t, svint16_t, svint16_t, uint64_t);
21414__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_lane_s64)))
21415svint64_t svqdmlalt_lane(svint64_t, svint32_t, svint32_t, uint64_t);
21416__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_n_s32)))
21417svint32_t svqdmlslb(svint32_t, svint16_t, int16_t);
21418__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_n_s64)))
21419svint64_t svqdmlslb(svint64_t, svint32_t, int32_t);
21420__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_n_s16)))
21421svint16_t svqdmlslb(svint16_t, svint8_t, int8_t);
21422__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_s32)))
21423svint32_t svqdmlslb(svint32_t, svint16_t, svint16_t);
21424__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_s64)))
21425svint64_t svqdmlslb(svint64_t, svint32_t, svint32_t);
21426__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_s16)))
21427svint16_t svqdmlslb(svint16_t, svint8_t, svint8_t);
21428__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_lane_s32)))
21429svint32_t svqdmlslb_lane(svint32_t, svint16_t, svint16_t, uint64_t);
21430__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_lane_s64)))
21431svint64_t svqdmlslb_lane(svint64_t, svint32_t, svint32_t, uint64_t);
21432__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslbt_n_s32)))
21433svint32_t svqdmlslbt(svint32_t, svint16_t, int16_t);
21434__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslbt_n_s64)))
21435svint64_t svqdmlslbt(svint64_t, svint32_t, int32_t);
21436__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslbt_n_s16)))
21437svint16_t svqdmlslbt(svint16_t, svint8_t, int8_t);
21438__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslbt_s32)))
21439svint32_t svqdmlslbt(svint32_t, svint16_t, svint16_t);
21440__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslbt_s64)))
21441svint64_t svqdmlslbt(svint64_t, svint32_t, svint32_t);
21442__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslbt_s16)))
21443svint16_t svqdmlslbt(svint16_t, svint8_t, svint8_t);
21444__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_n_s32)))
21445svint32_t svqdmlslt(svint32_t, svint16_t, int16_t);
21446__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_n_s64)))
21447svint64_t svqdmlslt(svint64_t, svint32_t, int32_t);
21448__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_n_s16)))
21449svint16_t svqdmlslt(svint16_t, svint8_t, int8_t);
21450__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_s32)))
21451svint32_t svqdmlslt(svint32_t, svint16_t, svint16_t);
21452__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_s64)))
21453svint64_t svqdmlslt(svint64_t, svint32_t, svint32_t);
21454__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_s16)))
21455svint16_t svqdmlslt(svint16_t, svint8_t, svint8_t);
21456__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_lane_s32)))
21457svint32_t svqdmlslt_lane(svint32_t, svint16_t, svint16_t, uint64_t);
21458__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_lane_s64)))
21459svint64_t svqdmlslt_lane(svint64_t, svint32_t, svint32_t, uint64_t);
21460__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_n_s8)))
21461svint8_t svqdmulh(svint8_t, int8_t);
21462__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_n_s32)))
21463svint32_t svqdmulh(svint32_t, int32_t);
21464__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_n_s64)))
21465svint64_t svqdmulh(svint64_t, int64_t);
21466__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_n_s16)))
21467svint16_t svqdmulh(svint16_t, int16_t);
21468__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_s8)))
21469svint8_t svqdmulh(svint8_t, svint8_t);
21470__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_s32)))
21471svint32_t svqdmulh(svint32_t, svint32_t);
21472__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_s64)))
21473svint64_t svqdmulh(svint64_t, svint64_t);
21474__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_s16)))
21475svint16_t svqdmulh(svint16_t, svint16_t);
21476__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_lane_s32)))
21477svint32_t svqdmulh_lane(svint32_t, svint32_t, uint64_t);
21478__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_lane_s64)))
21479svint64_t svqdmulh_lane(svint64_t, svint64_t, uint64_t);
21480__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_lane_s16)))
21481svint16_t svqdmulh_lane(svint16_t, svint16_t, uint64_t);
21482__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_n_s32)))
21483svint32_t svqdmullb(svint16_t, int16_t);
21484__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_n_s64)))
21485svint64_t svqdmullb(svint32_t, int32_t);
21486__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_n_s16)))
21487svint16_t svqdmullb(svint8_t, int8_t);
21488__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_s32)))
21489svint32_t svqdmullb(svint16_t, svint16_t);
21490__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_s64)))
21491svint64_t svqdmullb(svint32_t, svint32_t);
21492__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_s16)))
21493svint16_t svqdmullb(svint8_t, svint8_t);
21494__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_lane_s32)))
21495svint32_t svqdmullb_lane(svint16_t, svint16_t, uint64_t);
21496__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_lane_s64)))
21497svint64_t svqdmullb_lane(svint32_t, svint32_t, uint64_t);
21498__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_n_s32)))
21499svint32_t svqdmullt(svint16_t, int16_t);
21500__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_n_s64)))
21501svint64_t svqdmullt(svint32_t, int32_t);
21502__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_n_s16)))
21503svint16_t svqdmullt(svint8_t, int8_t);
21504__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_s32)))
21505svint32_t svqdmullt(svint16_t, svint16_t);
21506__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_s64)))
21507svint64_t svqdmullt(svint32_t, svint32_t);
21508__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_s16)))
21509svint16_t svqdmullt(svint8_t, svint8_t);
21510__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_lane_s32)))
21511svint32_t svqdmullt_lane(svint16_t, svint16_t, uint64_t);
21512__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_lane_s64)))
21513svint64_t svqdmullt_lane(svint32_t, svint32_t, uint64_t);
21514__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s8_m)))
21515svint8_t svqneg_m(svint8_t, svbool_t, svint8_t);
21516__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s32_m)))
21517svint32_t svqneg_m(svint32_t, svbool_t, svint32_t);
21518__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s64_m)))
21519svint64_t svqneg_m(svint64_t, svbool_t, svint64_t);
21520__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s16_m)))
21521svint16_t svqneg_m(svint16_t, svbool_t, svint16_t);
21522__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s8_x)))
21523svint8_t svqneg_x(svbool_t, svint8_t);
21524__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s32_x)))
21525svint32_t svqneg_x(svbool_t, svint32_t);
21526__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s64_x)))
21527svint64_t svqneg_x(svbool_t, svint64_t);
21528__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s16_x)))
21529svint16_t svqneg_x(svbool_t, svint16_t);
21530__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s8_z)))
21531svint8_t svqneg_z(svbool_t, svint8_t);
21532__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s32_z)))
21533svint32_t svqneg_z(svbool_t, svint32_t);
21534__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s64_z)))
21535svint64_t svqneg_z(svbool_t, svint64_t);
21536__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s16_z)))
21537svint16_t svqneg_z(svbool_t, svint16_t);
21538__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdcmlah_s8)))
21539svint8_t svqrdcmlah(svint8_t, svint8_t, svint8_t, uint64_t);
21540__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdcmlah_s32)))
21541svint32_t svqrdcmlah(svint32_t, svint32_t, svint32_t, uint64_t);
21542__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdcmlah_s64)))
21543svint64_t svqrdcmlah(svint64_t, svint64_t, svint64_t, uint64_t);
21544__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdcmlah_s16)))
21545svint16_t svqrdcmlah(svint16_t, svint16_t, svint16_t, uint64_t);
21546__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdcmlah_lane_s32)))
21547svint32_t svqrdcmlah_lane(svint32_t, svint32_t, svint32_t, uint64_t, uint64_t);
21548__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdcmlah_lane_s16)))
21549svint16_t svqrdcmlah_lane(svint16_t, svint16_t, svint16_t, uint64_t, uint64_t);
21550__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_n_s8)))
21551svint8_t svqrdmlah(svint8_t, svint8_t, int8_t);
21552__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_n_s32)))
21553svint32_t svqrdmlah(svint32_t, svint32_t, int32_t);
21554__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_n_s64)))
21555svint64_t svqrdmlah(svint64_t, svint64_t, int64_t);
21556__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_n_s16)))
21557svint16_t svqrdmlah(svint16_t, svint16_t, int16_t);
21558__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_s8)))
21559svint8_t svqrdmlah(svint8_t, svint8_t, svint8_t);
21560__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_s32)))
21561svint32_t svqrdmlah(svint32_t, svint32_t, svint32_t);
21562__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_s64)))
21563svint64_t svqrdmlah(svint64_t, svint64_t, svint64_t);
21564__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_s16)))
21565svint16_t svqrdmlah(svint16_t, svint16_t, svint16_t);
21566__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_lane_s32)))
21567svint32_t svqrdmlah_lane(svint32_t, svint32_t, svint32_t, uint64_t);
21568__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_lane_s64)))
21569svint64_t svqrdmlah_lane(svint64_t, svint64_t, svint64_t, uint64_t);
21570__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_lane_s16)))
21571svint16_t svqrdmlah_lane(svint16_t, svint16_t, svint16_t, uint64_t);
21572__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_n_s8)))
21573svint8_t svqrdmlsh(svint8_t, svint8_t, int8_t);
21574__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_n_s32)))
21575svint32_t svqrdmlsh(svint32_t, svint32_t, int32_t);
21576__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_n_s64)))
21577svint64_t svqrdmlsh(svint64_t, svint64_t, int64_t);
21578__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_n_s16)))
21579svint16_t svqrdmlsh(svint16_t, svint16_t, int16_t);
21580__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_s8)))
21581svint8_t svqrdmlsh(svint8_t, svint8_t, svint8_t);
21582__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_s32)))
21583svint32_t svqrdmlsh(svint32_t, svint32_t, svint32_t);
21584__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_s64)))
21585svint64_t svqrdmlsh(svint64_t, svint64_t, svint64_t);
21586__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_s16)))
21587svint16_t svqrdmlsh(svint16_t, svint16_t, svint16_t);
21588__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_lane_s32)))
21589svint32_t svqrdmlsh_lane(svint32_t, svint32_t, svint32_t, uint64_t);
21590__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_lane_s64)))
21591svint64_t svqrdmlsh_lane(svint64_t, svint64_t, svint64_t, uint64_t);
21592__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_lane_s16)))
21593svint16_t svqrdmlsh_lane(svint16_t, svint16_t, svint16_t, uint64_t);
21594__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_n_s8)))
21595svint8_t svqrdmulh(svint8_t, int8_t);
21596__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_n_s32)))
21597svint32_t svqrdmulh(svint32_t, int32_t);
21598__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_n_s64)))
21599svint64_t svqrdmulh(svint64_t, int64_t);
21600__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_n_s16)))
21601svint16_t svqrdmulh(svint16_t, int16_t);
21602__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_s8)))
21603svint8_t svqrdmulh(svint8_t, svint8_t);
21604__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_s32)))
21605svint32_t svqrdmulh(svint32_t, svint32_t);
21606__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_s64)))
21607svint64_t svqrdmulh(svint64_t, svint64_t);
21608__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_s16)))
21609svint16_t svqrdmulh(svint16_t, svint16_t);
21610__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_lane_s32)))
21611svint32_t svqrdmulh_lane(svint32_t, svint32_t, uint64_t);
21612__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_lane_s64)))
21613svint64_t svqrdmulh_lane(svint64_t, svint64_t, uint64_t);
21614__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_lane_s16)))
21615svint16_t svqrdmulh_lane(svint16_t, svint16_t, uint64_t);
21616__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s8_m)))
21617svint8_t svqrshl_m(svbool_t, svint8_t, int8_t);
21618__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s32_m)))
21619svint32_t svqrshl_m(svbool_t, svint32_t, int32_t);
21620__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s64_m)))
21621svint64_t svqrshl_m(svbool_t, svint64_t, int64_t);
21622__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s16_m)))
21623svint16_t svqrshl_m(svbool_t, svint16_t, int16_t);
21624__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s8_x)))
21625svint8_t svqrshl_x(svbool_t, svint8_t, int8_t);
21626__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s32_x)))
21627svint32_t svqrshl_x(svbool_t, svint32_t, int32_t);
21628__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s64_x)))
21629svint64_t svqrshl_x(svbool_t, svint64_t, int64_t);
21630__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s16_x)))
21631svint16_t svqrshl_x(svbool_t, svint16_t, int16_t);
21632__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s8_z)))
21633svint8_t svqrshl_z(svbool_t, svint8_t, int8_t);
21634__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s32_z)))
21635svint32_t svqrshl_z(svbool_t, svint32_t, int32_t);
21636__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s64_z)))
21637svint64_t svqrshl_z(svbool_t, svint64_t, int64_t);
21638__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s16_z)))
21639svint16_t svqrshl_z(svbool_t, svint16_t, int16_t);
21640__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u8_m)))
21641svuint8_t svqrshl_m(svbool_t, svuint8_t, int8_t);
21642__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u32_m)))
21643svuint32_t svqrshl_m(svbool_t, svuint32_t, int32_t);
21644__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u64_m)))
21645svuint64_t svqrshl_m(svbool_t, svuint64_t, int64_t);
21646__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u16_m)))
21647svuint16_t svqrshl_m(svbool_t, svuint16_t, int16_t);
21648__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u8_x)))
21649svuint8_t svqrshl_x(svbool_t, svuint8_t, int8_t);
21650__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u32_x)))
21651svuint32_t svqrshl_x(svbool_t, svuint32_t, int32_t);
21652__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u64_x)))
21653svuint64_t svqrshl_x(svbool_t, svuint64_t, int64_t);
21654__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u16_x)))
21655svuint16_t svqrshl_x(svbool_t, svuint16_t, int16_t);
21656__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u8_z)))
21657svuint8_t svqrshl_z(svbool_t, svuint8_t, int8_t);
21658__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u32_z)))
21659svuint32_t svqrshl_z(svbool_t, svuint32_t, int32_t);
21660__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u64_z)))
21661svuint64_t svqrshl_z(svbool_t, svuint64_t, int64_t);
21662__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u16_z)))
21663svuint16_t svqrshl_z(svbool_t, svuint16_t, int16_t);
21664__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s8_m)))
21665svint8_t svqrshl_m(svbool_t, svint8_t, svint8_t);
21666__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s32_m)))
21667svint32_t svqrshl_m(svbool_t, svint32_t, svint32_t);
21668__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s64_m)))
21669svint64_t svqrshl_m(svbool_t, svint64_t, svint64_t);
21670__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s16_m)))
21671svint16_t svqrshl_m(svbool_t, svint16_t, svint16_t);
21672__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s8_x)))
21673svint8_t svqrshl_x(svbool_t, svint8_t, svint8_t);
21674__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s32_x)))
21675svint32_t svqrshl_x(svbool_t, svint32_t, svint32_t);
21676__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s64_x)))
21677svint64_t svqrshl_x(svbool_t, svint64_t, svint64_t);
21678__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s16_x)))
21679svint16_t svqrshl_x(svbool_t, svint16_t, svint16_t);
21680__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s8_z)))
21681svint8_t svqrshl_z(svbool_t, svint8_t, svint8_t);
21682__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s32_z)))
21683svint32_t svqrshl_z(svbool_t, svint32_t, svint32_t);
21684__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s64_z)))
21685svint64_t svqrshl_z(svbool_t, svint64_t, svint64_t);
21686__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s16_z)))
21687svint16_t svqrshl_z(svbool_t, svint16_t, svint16_t);
21688__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u8_m)))
21689svuint8_t svqrshl_m(svbool_t, svuint8_t, svint8_t);
21690__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u32_m)))
21691svuint32_t svqrshl_m(svbool_t, svuint32_t, svint32_t);
21692__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u64_m)))
21693svuint64_t svqrshl_m(svbool_t, svuint64_t, svint64_t);
21694__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u16_m)))
21695svuint16_t svqrshl_m(svbool_t, svuint16_t, svint16_t);
21696__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u8_x)))
21697svuint8_t svqrshl_x(svbool_t, svuint8_t, svint8_t);
21698__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u32_x)))
21699svuint32_t svqrshl_x(svbool_t, svuint32_t, svint32_t);
21700__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u64_x)))
21701svuint64_t svqrshl_x(svbool_t, svuint64_t, svint64_t);
21702__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u16_x)))
21703svuint16_t svqrshl_x(svbool_t, svuint16_t, svint16_t);
21704__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u8_z)))
21705svuint8_t svqrshl_z(svbool_t, svuint8_t, svint8_t);
21706__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u32_z)))
21707svuint32_t svqrshl_z(svbool_t, svuint32_t, svint32_t);
21708__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u64_z)))
21709svuint64_t svqrshl_z(svbool_t, svuint64_t, svint64_t);
21710__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u16_z)))
21711svuint16_t svqrshl_z(svbool_t, svuint16_t, svint16_t);
21712__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnb_n_s32)))
21713svint16_t svqrshrnb(svint32_t, uint64_t);
21714__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnb_n_s64)))
21715svint32_t svqrshrnb(svint64_t, uint64_t);
21716__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnb_n_s16)))
21717svint8_t svqrshrnb(svint16_t, uint64_t);
21718__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnb_n_u32)))
21719svuint16_t svqrshrnb(svuint32_t, uint64_t);
21720__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnb_n_u64)))
21721svuint32_t svqrshrnb(svuint64_t, uint64_t);
21722__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnb_n_u16)))
21723svuint8_t svqrshrnb(svuint16_t, uint64_t);
21724__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnt_n_s32)))
21725svint16_t svqrshrnt(svint16_t, svint32_t, uint64_t);
21726__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnt_n_s64)))
21727svint32_t svqrshrnt(svint32_t, svint64_t, uint64_t);
21728__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnt_n_s16)))
21729svint8_t svqrshrnt(svint8_t, svint16_t, uint64_t);
21730__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnt_n_u32)))
21731svuint16_t svqrshrnt(svuint16_t, svuint32_t, uint64_t);
21732__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnt_n_u64)))
21733svuint32_t svqrshrnt(svuint32_t, svuint64_t, uint64_t);
21734__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnt_n_u16)))
21735svuint8_t svqrshrnt(svuint8_t, svuint16_t, uint64_t);
21736__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrunb_n_s32)))
21737svuint16_t svqrshrunb(svint32_t, uint64_t);
21738__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrunb_n_s64)))
21739svuint32_t svqrshrunb(svint64_t, uint64_t);
21740__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrunb_n_s16)))
21741svuint8_t svqrshrunb(svint16_t, uint64_t);
21742__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrunt_n_s32)))
21743svuint16_t svqrshrunt(svuint16_t, svint32_t, uint64_t);
21744__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrunt_n_s64)))
21745svuint32_t svqrshrunt(svuint32_t, svint64_t, uint64_t);
21746__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrunt_n_s16)))
21747svuint8_t svqrshrunt(svuint8_t, svint16_t, uint64_t);
21748__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s8_m)))
21749svint8_t svqshl_m(svbool_t, svint8_t, int8_t);
21750__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s32_m)))
21751svint32_t svqshl_m(svbool_t, svint32_t, int32_t);
21752__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s64_m)))
21753svint64_t svqshl_m(svbool_t, svint64_t, int64_t);
21754__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s16_m)))
21755svint16_t svqshl_m(svbool_t, svint16_t, int16_t);
21756__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s8_x)))
21757svint8_t svqshl_x(svbool_t, svint8_t, int8_t);
21758__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s32_x)))
21759svint32_t svqshl_x(svbool_t, svint32_t, int32_t);
21760__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s64_x)))
21761svint64_t svqshl_x(svbool_t, svint64_t, int64_t);
21762__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s16_x)))
21763svint16_t svqshl_x(svbool_t, svint16_t, int16_t);
21764__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s8_z)))
21765svint8_t svqshl_z(svbool_t, svint8_t, int8_t);
21766__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s32_z)))
21767svint32_t svqshl_z(svbool_t, svint32_t, int32_t);
21768__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s64_z)))
21769svint64_t svqshl_z(svbool_t, svint64_t, int64_t);
21770__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s16_z)))
21771svint16_t svqshl_z(svbool_t, svint16_t, int16_t);
21772__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u8_m)))
21773svuint8_t svqshl_m(svbool_t, svuint8_t, int8_t);
21774__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u32_m)))
21775svuint32_t svqshl_m(svbool_t, svuint32_t, int32_t);
21776__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u64_m)))
21777svuint64_t svqshl_m(svbool_t, svuint64_t, int64_t);
21778__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u16_m)))
21779svuint16_t svqshl_m(svbool_t, svuint16_t, int16_t);
21780__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u8_x)))
21781svuint8_t svqshl_x(svbool_t, svuint8_t, int8_t);
21782__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u32_x)))
21783svuint32_t svqshl_x(svbool_t, svuint32_t, int32_t);
21784__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u64_x)))
21785svuint64_t svqshl_x(svbool_t, svuint64_t, int64_t);
21786__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u16_x)))
21787svuint16_t svqshl_x(svbool_t, svuint16_t, int16_t);
21788__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u8_z)))
21789svuint8_t svqshl_z(svbool_t, svuint8_t, int8_t);
21790__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u32_z)))
21791svuint32_t svqshl_z(svbool_t, svuint32_t, int32_t);
21792__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u64_z)))
21793svuint64_t svqshl_z(svbool_t, svuint64_t, int64_t);
21794__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u16_z)))
21795svuint16_t svqshl_z(svbool_t, svuint16_t, int16_t);
21796__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s8_m)))
21797svint8_t svqshl_m(svbool_t, svint8_t, svint8_t);
21798__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s32_m)))
21799svint32_t svqshl_m(svbool_t, svint32_t, svint32_t);
21800__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s64_m)))
21801svint64_t svqshl_m(svbool_t, svint64_t, svint64_t);
21802__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s16_m)))
21803svint16_t svqshl_m(svbool_t, svint16_t, svint16_t);
21804__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s8_x)))
21805svint8_t svqshl_x(svbool_t, svint8_t, svint8_t);
21806__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s32_x)))
21807svint32_t svqshl_x(svbool_t, svint32_t, svint32_t);
21808__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s64_x)))
21809svint64_t svqshl_x(svbool_t, svint64_t, svint64_t);
21810__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s16_x)))
21811svint16_t svqshl_x(svbool_t, svint16_t, svint16_t);
21812__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s8_z)))
21813svint8_t svqshl_z(svbool_t, svint8_t, svint8_t);
21814__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s32_z)))
21815svint32_t svqshl_z(svbool_t, svint32_t, svint32_t);
21816__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s64_z)))
21817svint64_t svqshl_z(svbool_t, svint64_t, svint64_t);
21818__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s16_z)))
21819svint16_t svqshl_z(svbool_t, svint16_t, svint16_t);
21820__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u8_m)))
21821svuint8_t svqshl_m(svbool_t, svuint8_t, svint8_t);
21822__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u32_m)))
21823svuint32_t svqshl_m(svbool_t, svuint32_t, svint32_t);
21824__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u64_m)))
21825svuint64_t svqshl_m(svbool_t, svuint64_t, svint64_t);
21826__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u16_m)))
21827svuint16_t svqshl_m(svbool_t, svuint16_t, svint16_t);
21828__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u8_x)))
21829svuint8_t svqshl_x(svbool_t, svuint8_t, svint8_t);
21830__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u32_x)))
21831svuint32_t svqshl_x(svbool_t, svuint32_t, svint32_t);
21832__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u64_x)))
21833svuint64_t svqshl_x(svbool_t, svuint64_t, svint64_t);
21834__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u16_x)))
21835svuint16_t svqshl_x(svbool_t, svuint16_t, svint16_t);
21836__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u8_z)))
21837svuint8_t svqshl_z(svbool_t, svuint8_t, svint8_t);
21838__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u32_z)))
21839svuint32_t svqshl_z(svbool_t, svuint32_t, svint32_t);
21840__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u64_z)))
21841svuint64_t svqshl_z(svbool_t, svuint64_t, svint64_t);
21842__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u16_z)))
21843svuint16_t svqshl_z(svbool_t, svuint16_t, svint16_t);
21844__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s8_m)))
21845svuint8_t svqshlu_m(svbool_t, svint8_t, uint64_t);
21846__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s32_m)))
21847svuint32_t svqshlu_m(svbool_t, svint32_t, uint64_t);
21848__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s64_m)))
21849svuint64_t svqshlu_m(svbool_t, svint64_t, uint64_t);
21850__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s16_m)))
21851svuint16_t svqshlu_m(svbool_t, svint16_t, uint64_t);
21852__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s8_x)))
21853svuint8_t svqshlu_x(svbool_t, svint8_t, uint64_t);
21854__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s32_x)))
21855svuint32_t svqshlu_x(svbool_t, svint32_t, uint64_t);
21856__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s64_x)))
21857svuint64_t svqshlu_x(svbool_t, svint64_t, uint64_t);
21858__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s16_x)))
21859svuint16_t svqshlu_x(svbool_t, svint16_t, uint64_t);
21860__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s8_z)))
21861svuint8_t svqshlu_z(svbool_t, svint8_t, uint64_t);
21862__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s32_z)))
21863svuint32_t svqshlu_z(svbool_t, svint32_t, uint64_t);
21864__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s64_z)))
21865svuint64_t svqshlu_z(svbool_t, svint64_t, uint64_t);
21866__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s16_z)))
21867svuint16_t svqshlu_z(svbool_t, svint16_t, uint64_t);
21868__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnb_n_s32)))
21869svint16_t svqshrnb(svint32_t, uint64_t);
21870__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnb_n_s64)))
21871svint32_t svqshrnb(svint64_t, uint64_t);
21872__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnb_n_s16)))
21873svint8_t svqshrnb(svint16_t, uint64_t);
21874__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnb_n_u32)))
21875svuint16_t svqshrnb(svuint32_t, uint64_t);
21876__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnb_n_u64)))
21877svuint32_t svqshrnb(svuint64_t, uint64_t);
21878__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnb_n_u16)))
21879svuint8_t svqshrnb(svuint16_t, uint64_t);
21880__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnt_n_s32)))
21881svint16_t svqshrnt(svint16_t, svint32_t, uint64_t);
21882__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnt_n_s64)))
21883svint32_t svqshrnt(svint32_t, svint64_t, uint64_t);
21884__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnt_n_s16)))
21885svint8_t svqshrnt(svint8_t, svint16_t, uint64_t);
21886__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnt_n_u32)))
21887svuint16_t svqshrnt(svuint16_t, svuint32_t, uint64_t);
21888__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnt_n_u64)))
21889svuint32_t svqshrnt(svuint32_t, svuint64_t, uint64_t);
21890__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnt_n_u16)))
21891svuint8_t svqshrnt(svuint8_t, svuint16_t, uint64_t);
21892__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrunb_n_s32)))
21893svuint16_t svqshrunb(svint32_t, uint64_t);
21894__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrunb_n_s64)))
21895svuint32_t svqshrunb(svint64_t, uint64_t);
21896__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrunb_n_s16)))
21897svuint8_t svqshrunb(svint16_t, uint64_t);
21898__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrunt_n_s32)))
21899svuint16_t svqshrunt(svuint16_t, svint32_t, uint64_t);
21900__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrunt_n_s64)))
21901svuint32_t svqshrunt(svuint32_t, svint64_t, uint64_t);
21902__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrunt_n_s16)))
21903svuint8_t svqshrunt(svuint8_t, svint16_t, uint64_t);
21904__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s8_m)))
21905svint8_t svqsub_m(svbool_t, svint8_t, int8_t);
21906__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s32_m)))
21907svint32_t svqsub_m(svbool_t, svint32_t, int32_t);
21908__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s64_m)))
21909svint64_t svqsub_m(svbool_t, svint64_t, int64_t);
21910__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s16_m)))
21911svint16_t svqsub_m(svbool_t, svint16_t, int16_t);
21912__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s8_x)))
21913svint8_t svqsub_x(svbool_t, svint8_t, int8_t);
21914__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s32_x)))
21915svint32_t svqsub_x(svbool_t, svint32_t, int32_t);
21916__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s64_x)))
21917svint64_t svqsub_x(svbool_t, svint64_t, int64_t);
21918__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s16_x)))
21919svint16_t svqsub_x(svbool_t, svint16_t, int16_t);
21920__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s8_z)))
21921svint8_t svqsub_z(svbool_t, svint8_t, int8_t);
21922__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s32_z)))
21923svint32_t svqsub_z(svbool_t, svint32_t, int32_t);
21924__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s64_z)))
21925svint64_t svqsub_z(svbool_t, svint64_t, int64_t);
21926__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s16_z)))
21927svint16_t svqsub_z(svbool_t, svint16_t, int16_t);
21928__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u8_m)))
21929svuint8_t svqsub_m(svbool_t, svuint8_t, uint8_t);
21930__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u32_m)))
21931svuint32_t svqsub_m(svbool_t, svuint32_t, uint32_t);
21932__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u64_m)))
21933svuint64_t svqsub_m(svbool_t, svuint64_t, uint64_t);
21934__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u16_m)))
21935svuint16_t svqsub_m(svbool_t, svuint16_t, uint16_t);
21936__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u8_x)))
21937svuint8_t svqsub_x(svbool_t, svuint8_t, uint8_t);
21938__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u32_x)))
21939svuint32_t svqsub_x(svbool_t, svuint32_t, uint32_t);
21940__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u64_x)))
21941svuint64_t svqsub_x(svbool_t, svuint64_t, uint64_t);
21942__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u16_x)))
21943svuint16_t svqsub_x(svbool_t, svuint16_t, uint16_t);
21944__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u8_z)))
21945svuint8_t svqsub_z(svbool_t, svuint8_t, uint8_t);
21946__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u32_z)))
21947svuint32_t svqsub_z(svbool_t, svuint32_t, uint32_t);
21948__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u64_z)))
21949svuint64_t svqsub_z(svbool_t, svuint64_t, uint64_t);
21950__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u16_z)))
21951svuint16_t svqsub_z(svbool_t, svuint16_t, uint16_t);
21952__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s8_m)))
21953svint8_t svqsub_m(svbool_t, svint8_t, svint8_t);
21954__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s32_m)))
21955svint32_t svqsub_m(svbool_t, svint32_t, svint32_t);
21956__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s64_m)))
21957svint64_t svqsub_m(svbool_t, svint64_t, svint64_t);
21958__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s16_m)))
21959svint16_t svqsub_m(svbool_t, svint16_t, svint16_t);
21960__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s8_x)))
21961svint8_t svqsub_x(svbool_t, svint8_t, svint8_t);
21962__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s32_x)))
21963svint32_t svqsub_x(svbool_t, svint32_t, svint32_t);
21964__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s64_x)))
21965svint64_t svqsub_x(svbool_t, svint64_t, svint64_t);
21966__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s16_x)))
21967svint16_t svqsub_x(svbool_t, svint16_t, svint16_t);
21968__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s8_z)))
21969svint8_t svqsub_z(svbool_t, svint8_t, svint8_t);
21970__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s32_z)))
21971svint32_t svqsub_z(svbool_t, svint32_t, svint32_t);
21972__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s64_z)))
21973svint64_t svqsub_z(svbool_t, svint64_t, svint64_t);
21974__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s16_z)))
21975svint16_t svqsub_z(svbool_t, svint16_t, svint16_t);
21976__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u8_m)))
21977svuint8_t svqsub_m(svbool_t, svuint8_t, svuint8_t);
21978__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u32_m)))
21979svuint32_t svqsub_m(svbool_t, svuint32_t, svuint32_t);
21980__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u64_m)))
21981svuint64_t svqsub_m(svbool_t, svuint64_t, svuint64_t);
21982__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u16_m)))
21983svuint16_t svqsub_m(svbool_t, svuint16_t, svuint16_t);
21984__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u8_x)))
21985svuint8_t svqsub_x(svbool_t, svuint8_t, svuint8_t);
21986__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u32_x)))
21987svuint32_t svqsub_x(svbool_t, svuint32_t, svuint32_t);
21988__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u64_x)))
21989svuint64_t svqsub_x(svbool_t, svuint64_t, svuint64_t);
21990__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u16_x)))
21991svuint16_t svqsub_x(svbool_t, svuint16_t, svuint16_t);
21992__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u8_z)))
21993svuint8_t svqsub_z(svbool_t, svuint8_t, svuint8_t);
21994__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u32_z)))
21995svuint32_t svqsub_z(svbool_t, svuint32_t, svuint32_t);
21996__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u64_z)))
21997svuint64_t svqsub_z(svbool_t, svuint64_t, svuint64_t);
21998__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u16_z)))
21999svuint16_t svqsub_z(svbool_t, svuint16_t, svuint16_t);
22000__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s8_m)))
22001svint8_t svqsubr_m(svbool_t, svint8_t, int8_t);
22002__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s32_m)))
22003svint32_t svqsubr_m(svbool_t, svint32_t, int32_t);
22004__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s64_m)))
22005svint64_t svqsubr_m(svbool_t, svint64_t, int64_t);
22006__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s16_m)))
22007svint16_t svqsubr_m(svbool_t, svint16_t, int16_t);
22008__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s8_x)))
22009svint8_t svqsubr_x(svbool_t, svint8_t, int8_t);
22010__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s32_x)))
22011svint32_t svqsubr_x(svbool_t, svint32_t, int32_t);
22012__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s64_x)))
22013svint64_t svqsubr_x(svbool_t, svint64_t, int64_t);
22014__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s16_x)))
22015svint16_t svqsubr_x(svbool_t, svint16_t, int16_t);
22016__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s8_z)))
22017svint8_t svqsubr_z(svbool_t, svint8_t, int8_t);
22018__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s32_z)))
22019svint32_t svqsubr_z(svbool_t, svint32_t, int32_t);
22020__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s64_z)))
22021svint64_t svqsubr_z(svbool_t, svint64_t, int64_t);
22022__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s16_z)))
22023svint16_t svqsubr_z(svbool_t, svint16_t, int16_t);
22024__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u8_m)))
22025svuint8_t svqsubr_m(svbool_t, svuint8_t, uint8_t);
22026__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u32_m)))
22027svuint32_t svqsubr_m(svbool_t, svuint32_t, uint32_t);
22028__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u64_m)))
22029svuint64_t svqsubr_m(svbool_t, svuint64_t, uint64_t);
22030__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u16_m)))
22031svuint16_t svqsubr_m(svbool_t, svuint16_t, uint16_t);
22032__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u8_x)))
22033svuint8_t svqsubr_x(svbool_t, svuint8_t, uint8_t);
22034__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u32_x)))
22035svuint32_t svqsubr_x(svbool_t, svuint32_t, uint32_t);
22036__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u64_x)))
22037svuint64_t svqsubr_x(svbool_t, svuint64_t, uint64_t);
22038__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u16_x)))
22039svuint16_t svqsubr_x(svbool_t, svuint16_t, uint16_t);
22040__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u8_z)))
22041svuint8_t svqsubr_z(svbool_t, svuint8_t, uint8_t);
22042__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u32_z)))
22043svuint32_t svqsubr_z(svbool_t, svuint32_t, uint32_t);
22044__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u64_z)))
22045svuint64_t svqsubr_z(svbool_t, svuint64_t, uint64_t);
22046__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u16_z)))
22047svuint16_t svqsubr_z(svbool_t, svuint16_t, uint16_t);
22048__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s8_m)))
22049svint8_t svqsubr_m(svbool_t, svint8_t, svint8_t);
22050__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s32_m)))
22051svint32_t svqsubr_m(svbool_t, svint32_t, svint32_t);
22052__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s64_m)))
22053svint64_t svqsubr_m(svbool_t, svint64_t, svint64_t);
22054__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s16_m)))
22055svint16_t svqsubr_m(svbool_t, svint16_t, svint16_t);
22056__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s8_x)))
22057svint8_t svqsubr_x(svbool_t, svint8_t, svint8_t);
22058__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s32_x)))
22059svint32_t svqsubr_x(svbool_t, svint32_t, svint32_t);
22060__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s64_x)))
22061svint64_t svqsubr_x(svbool_t, svint64_t, svint64_t);
22062__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s16_x)))
22063svint16_t svqsubr_x(svbool_t, svint16_t, svint16_t);
22064__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s8_z)))
22065svint8_t svqsubr_z(svbool_t, svint8_t, svint8_t);
22066__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s32_z)))
22067svint32_t svqsubr_z(svbool_t, svint32_t, svint32_t);
22068__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s64_z)))
22069svint64_t svqsubr_z(svbool_t, svint64_t, svint64_t);
22070__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s16_z)))
22071svint16_t svqsubr_z(svbool_t, svint16_t, svint16_t);
22072__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u8_m)))
22073svuint8_t svqsubr_m(svbool_t, svuint8_t, svuint8_t);
22074__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u32_m)))
22075svuint32_t svqsubr_m(svbool_t, svuint32_t, svuint32_t);
22076__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u64_m)))
22077svuint64_t svqsubr_m(svbool_t, svuint64_t, svuint64_t);
22078__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u16_m)))
22079svuint16_t svqsubr_m(svbool_t, svuint16_t, svuint16_t);
22080__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u8_x)))
22081svuint8_t svqsubr_x(svbool_t, svuint8_t, svuint8_t);
22082__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u32_x)))
22083svuint32_t svqsubr_x(svbool_t, svuint32_t, svuint32_t);
22084__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u64_x)))
22085svuint64_t svqsubr_x(svbool_t, svuint64_t, svuint64_t);
22086__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u16_x)))
22087svuint16_t svqsubr_x(svbool_t, svuint16_t, svuint16_t);
22088__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u8_z)))
22089svuint8_t svqsubr_z(svbool_t, svuint8_t, svuint8_t);
22090__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u32_z)))
22091svuint32_t svqsubr_z(svbool_t, svuint32_t, svuint32_t);
22092__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u64_z)))
22093svuint64_t svqsubr_z(svbool_t, svuint64_t, svuint64_t);
22094__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u16_z)))
22095svuint16_t svqsubr_z(svbool_t, svuint16_t, svuint16_t);
22096__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnb_s32)))
22097svint16_t svqxtnb(svint32_t);
22098__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnb_s64)))
22099svint32_t svqxtnb(svint64_t);
22100__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnb_s16)))
22101svint8_t svqxtnb(svint16_t);
22102__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnb_u32)))
22103svuint16_t svqxtnb(svuint32_t);
22104__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnb_u64)))
22105svuint32_t svqxtnb(svuint64_t);
22106__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnb_u16)))
22107svuint8_t svqxtnb(svuint16_t);
22108__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnt_s32)))
22109svint16_t svqxtnt(svint16_t, svint32_t);
22110__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnt_s64)))
22111svint32_t svqxtnt(svint32_t, svint64_t);
22112__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnt_s16)))
22113svint8_t svqxtnt(svint8_t, svint16_t);
22114__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnt_u32)))
22115svuint16_t svqxtnt(svuint16_t, svuint32_t);
22116__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnt_u64)))
22117svuint32_t svqxtnt(svuint32_t, svuint64_t);
22118__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnt_u16)))
22119svuint8_t svqxtnt(svuint8_t, svuint16_t);
22120__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtunb_s32)))
22121svuint16_t svqxtunb(svint32_t);
22122__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtunb_s64)))
22123svuint32_t svqxtunb(svint64_t);
22124__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtunb_s16)))
22125svuint8_t svqxtunb(svint16_t);
22126__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtunt_s32)))
22127svuint16_t svqxtunt(svuint16_t, svint32_t);
22128__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtunt_s64)))
22129svuint32_t svqxtunt(svuint32_t, svint64_t);
22130__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtunt_s16)))
22131svuint8_t svqxtunt(svuint8_t, svint16_t);
22132__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_n_u32)))
22133svuint16_t svraddhnb(svuint32_t, uint32_t);
22134__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_n_u64)))
22135svuint32_t svraddhnb(svuint64_t, uint64_t);
22136__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_n_u16)))
22137svuint8_t svraddhnb(svuint16_t, uint16_t);
22138__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_n_s32)))
22139svint16_t svraddhnb(svint32_t, int32_t);
22140__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_n_s64)))
22141svint32_t svraddhnb(svint64_t, int64_t);
22142__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_n_s16)))
22143svint8_t svraddhnb(svint16_t, int16_t);
22144__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_u32)))
22145svuint16_t svraddhnb(svuint32_t, svuint32_t);
22146__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_u64)))
22147svuint32_t svraddhnb(svuint64_t, svuint64_t);
22148__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_u16)))
22149svuint8_t svraddhnb(svuint16_t, svuint16_t);
22150__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_s32)))
22151svint16_t svraddhnb(svint32_t, svint32_t);
22152__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_s64)))
22153svint32_t svraddhnb(svint64_t, svint64_t);
22154__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_s16)))
22155svint8_t svraddhnb(svint16_t, svint16_t);
22156__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_n_u32)))
22157svuint16_t svraddhnt(svuint16_t, svuint32_t, uint32_t);
22158__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_n_u64)))
22159svuint32_t svraddhnt(svuint32_t, svuint64_t, uint64_t);
22160__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_n_u16)))
22161svuint8_t svraddhnt(svuint8_t, svuint16_t, uint16_t);
22162__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_n_s32)))
22163svint16_t svraddhnt(svint16_t, svint32_t, int32_t);
22164__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_n_s64)))
22165svint32_t svraddhnt(svint32_t, svint64_t, int64_t);
22166__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_n_s16)))
22167svint8_t svraddhnt(svint8_t, svint16_t, int16_t);
22168__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_u32)))
22169svuint16_t svraddhnt(svuint16_t, svuint32_t, svuint32_t);
22170__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_u64)))
22171svuint32_t svraddhnt(svuint32_t, svuint64_t, svuint64_t);
22172__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_u16)))
22173svuint8_t svraddhnt(svuint8_t, svuint16_t, svuint16_t);
22174__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_s32)))
22175svint16_t svraddhnt(svint16_t, svint32_t, svint32_t);
22176__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_s64)))
22177svint32_t svraddhnt(svint32_t, svint64_t, svint64_t);
22178__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_s16)))
22179svint8_t svraddhnt(svint8_t, svint16_t, svint16_t);
22180__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrecpe_u32_m)))
22181svuint32_t svrecpe_m(svuint32_t, svbool_t, svuint32_t);
22182__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrecpe_u32_x)))
22183svuint32_t svrecpe_x(svbool_t, svuint32_t);
22184__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrecpe_u32_z)))
22185svuint32_t svrecpe_z(svbool_t, svuint32_t);
22186__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s8_m)))
22187svint8_t svrhadd_m(svbool_t, svint8_t, int8_t);
22188__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s32_m)))
22189svint32_t svrhadd_m(svbool_t, svint32_t, int32_t);
22190__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s64_m)))
22191svint64_t svrhadd_m(svbool_t, svint64_t, int64_t);
22192__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s16_m)))
22193svint16_t svrhadd_m(svbool_t, svint16_t, int16_t);
22194__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s8_x)))
22195svint8_t svrhadd_x(svbool_t, svint8_t, int8_t);
22196__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s32_x)))
22197svint32_t svrhadd_x(svbool_t, svint32_t, int32_t);
22198__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s64_x)))
22199svint64_t svrhadd_x(svbool_t, svint64_t, int64_t);
22200__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s16_x)))
22201svint16_t svrhadd_x(svbool_t, svint16_t, int16_t);
22202__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s8_z)))
22203svint8_t svrhadd_z(svbool_t, svint8_t, int8_t);
22204__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s32_z)))
22205svint32_t svrhadd_z(svbool_t, svint32_t, int32_t);
22206__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s64_z)))
22207svint64_t svrhadd_z(svbool_t, svint64_t, int64_t);
22208__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s16_z)))
22209svint16_t svrhadd_z(svbool_t, svint16_t, int16_t);
22210__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u8_m)))
22211svuint8_t svrhadd_m(svbool_t, svuint8_t, uint8_t);
22212__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u32_m)))
22213svuint32_t svrhadd_m(svbool_t, svuint32_t, uint32_t);
22214__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u64_m)))
22215svuint64_t svrhadd_m(svbool_t, svuint64_t, uint64_t);
22216__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u16_m)))
22217svuint16_t svrhadd_m(svbool_t, svuint16_t, uint16_t);
22218__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u8_x)))
22219svuint8_t svrhadd_x(svbool_t, svuint8_t, uint8_t);
22220__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u32_x)))
22221svuint32_t svrhadd_x(svbool_t, svuint32_t, uint32_t);
22222__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u64_x)))
22223svuint64_t svrhadd_x(svbool_t, svuint64_t, uint64_t);
22224__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u16_x)))
22225svuint16_t svrhadd_x(svbool_t, svuint16_t, uint16_t);
22226__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u8_z)))
22227svuint8_t svrhadd_z(svbool_t, svuint8_t, uint8_t);
22228__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u32_z)))
22229svuint32_t svrhadd_z(svbool_t, svuint32_t, uint32_t);
22230__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u64_z)))
22231svuint64_t svrhadd_z(svbool_t, svuint64_t, uint64_t);
22232__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u16_z)))
22233svuint16_t svrhadd_z(svbool_t, svuint16_t, uint16_t);
22234__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s8_m)))
22235svint8_t svrhadd_m(svbool_t, svint8_t, svint8_t);
22236__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s32_m)))
22237svint32_t svrhadd_m(svbool_t, svint32_t, svint32_t);
22238__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s64_m)))
22239svint64_t svrhadd_m(svbool_t, svint64_t, svint64_t);
22240__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s16_m)))
22241svint16_t svrhadd_m(svbool_t, svint16_t, svint16_t);
22242__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s8_x)))
22243svint8_t svrhadd_x(svbool_t, svint8_t, svint8_t);
22244__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s32_x)))
22245svint32_t svrhadd_x(svbool_t, svint32_t, svint32_t);
22246__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s64_x)))
22247svint64_t svrhadd_x(svbool_t, svint64_t, svint64_t);
22248__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s16_x)))
22249svint16_t svrhadd_x(svbool_t, svint16_t, svint16_t);
22250__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s8_z)))
22251svint8_t svrhadd_z(svbool_t, svint8_t, svint8_t);
22252__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s32_z)))
22253svint32_t svrhadd_z(svbool_t, svint32_t, svint32_t);
22254__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s64_z)))
22255svint64_t svrhadd_z(svbool_t, svint64_t, svint64_t);
22256__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s16_z)))
22257svint16_t svrhadd_z(svbool_t, svint16_t, svint16_t);
22258__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u8_m)))
22259svuint8_t svrhadd_m(svbool_t, svuint8_t, svuint8_t);
22260__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u32_m)))
22261svuint32_t svrhadd_m(svbool_t, svuint32_t, svuint32_t);
22262__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u64_m)))
22263svuint64_t svrhadd_m(svbool_t, svuint64_t, svuint64_t);
22264__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u16_m)))
22265svuint16_t svrhadd_m(svbool_t, svuint16_t, svuint16_t);
22266__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u8_x)))
22267svuint8_t svrhadd_x(svbool_t, svuint8_t, svuint8_t);
22268__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u32_x)))
22269svuint32_t svrhadd_x(svbool_t, svuint32_t, svuint32_t);
22270__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u64_x)))
22271svuint64_t svrhadd_x(svbool_t, svuint64_t, svuint64_t);
22272__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u16_x)))
22273svuint16_t svrhadd_x(svbool_t, svuint16_t, svuint16_t);
22274__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u8_z)))
22275svuint8_t svrhadd_z(svbool_t, svuint8_t, svuint8_t);
22276__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u32_z)))
22277svuint32_t svrhadd_z(svbool_t, svuint32_t, svuint32_t);
22278__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u64_z)))
22279svuint64_t svrhadd_z(svbool_t, svuint64_t, svuint64_t);
22280__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u16_z)))
22281svuint16_t svrhadd_z(svbool_t, svuint16_t, svuint16_t);
22282__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s8_m)))
22283svint8_t svrshl_m(svbool_t, svint8_t, int8_t);
22284__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s32_m)))
22285svint32_t svrshl_m(svbool_t, svint32_t, int32_t);
22286__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s64_m)))
22287svint64_t svrshl_m(svbool_t, svint64_t, int64_t);
22288__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s16_m)))
22289svint16_t svrshl_m(svbool_t, svint16_t, int16_t);
22290__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s8_x)))
22291svint8_t svrshl_x(svbool_t, svint8_t, int8_t);
22292__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s32_x)))
22293svint32_t svrshl_x(svbool_t, svint32_t, int32_t);
22294__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s64_x)))
22295svint64_t svrshl_x(svbool_t, svint64_t, int64_t);
22296__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s16_x)))
22297svint16_t svrshl_x(svbool_t, svint16_t, int16_t);
22298__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s8_z)))
22299svint8_t svrshl_z(svbool_t, svint8_t, int8_t);
22300__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s32_z)))
22301svint32_t svrshl_z(svbool_t, svint32_t, int32_t);
22302__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s64_z)))
22303svint64_t svrshl_z(svbool_t, svint64_t, int64_t);
22304__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s16_z)))
22305svint16_t svrshl_z(svbool_t, svint16_t, int16_t);
22306__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u8_m)))
22307svuint8_t svrshl_m(svbool_t, svuint8_t, int8_t);
22308__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u32_m)))
22309svuint32_t svrshl_m(svbool_t, svuint32_t, int32_t);
22310__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u64_m)))
22311svuint64_t svrshl_m(svbool_t, svuint64_t, int64_t);
22312__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u16_m)))
22313svuint16_t svrshl_m(svbool_t, svuint16_t, int16_t);
22314__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u8_x)))
22315svuint8_t svrshl_x(svbool_t, svuint8_t, int8_t);
22316__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u32_x)))
22317svuint32_t svrshl_x(svbool_t, svuint32_t, int32_t);
22318__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u64_x)))
22319svuint64_t svrshl_x(svbool_t, svuint64_t, int64_t);
22320__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u16_x)))
22321svuint16_t svrshl_x(svbool_t, svuint16_t, int16_t);
22322__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u8_z)))
22323svuint8_t svrshl_z(svbool_t, svuint8_t, int8_t);
22324__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u32_z)))
22325svuint32_t svrshl_z(svbool_t, svuint32_t, int32_t);
22326__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u64_z)))
22327svuint64_t svrshl_z(svbool_t, svuint64_t, int64_t);
22328__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u16_z)))
22329svuint16_t svrshl_z(svbool_t, svuint16_t, int16_t);
22330__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s8_m)))
22331svint8_t svrshl_m(svbool_t, svint8_t, svint8_t);
22332__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s32_m)))
22333svint32_t svrshl_m(svbool_t, svint32_t, svint32_t);
22334__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s64_m)))
22335svint64_t svrshl_m(svbool_t, svint64_t, svint64_t);
22336__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s16_m)))
22337svint16_t svrshl_m(svbool_t, svint16_t, svint16_t);
22338__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s8_x)))
22339svint8_t svrshl_x(svbool_t, svint8_t, svint8_t);
22340__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s32_x)))
22341svint32_t svrshl_x(svbool_t, svint32_t, svint32_t);
22342__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s64_x)))
22343svint64_t svrshl_x(svbool_t, svint64_t, svint64_t);
22344__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s16_x)))
22345svint16_t svrshl_x(svbool_t, svint16_t, svint16_t);
22346__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s8_z)))
22347svint8_t svrshl_z(svbool_t, svint8_t, svint8_t);
22348__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s32_z)))
22349svint32_t svrshl_z(svbool_t, svint32_t, svint32_t);
22350__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s64_z)))
22351svint64_t svrshl_z(svbool_t, svint64_t, svint64_t);
22352__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s16_z)))
22353svint16_t svrshl_z(svbool_t, svint16_t, svint16_t);
22354__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u8_m)))
22355svuint8_t svrshl_m(svbool_t, svuint8_t, svint8_t);
22356__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u32_m)))
22357svuint32_t svrshl_m(svbool_t, svuint32_t, svint32_t);
22358__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u64_m)))
22359svuint64_t svrshl_m(svbool_t, svuint64_t, svint64_t);
22360__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u16_m)))
22361svuint16_t svrshl_m(svbool_t, svuint16_t, svint16_t);
22362__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u8_x)))
22363svuint8_t svrshl_x(svbool_t, svuint8_t, svint8_t);
22364__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u32_x)))
22365svuint32_t svrshl_x(svbool_t, svuint32_t, svint32_t);
22366__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u64_x)))
22367svuint64_t svrshl_x(svbool_t, svuint64_t, svint64_t);
22368__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u16_x)))
22369svuint16_t svrshl_x(svbool_t, svuint16_t, svint16_t);
22370__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u8_z)))
22371svuint8_t svrshl_z(svbool_t, svuint8_t, svint8_t);
22372__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u32_z)))
22373svuint32_t svrshl_z(svbool_t, svuint32_t, svint32_t);
22374__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u64_z)))
22375svuint64_t svrshl_z(svbool_t, svuint64_t, svint64_t);
22376__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u16_z)))
22377svuint16_t svrshl_z(svbool_t, svuint16_t, svint16_t);
22378__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s8_m)))
22379svint8_t svrshr_m(svbool_t, svint8_t, uint64_t);
22380__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s32_m)))
22381svint32_t svrshr_m(svbool_t, svint32_t, uint64_t);
22382__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s64_m)))
22383svint64_t svrshr_m(svbool_t, svint64_t, uint64_t);
22384__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s16_m)))
22385svint16_t svrshr_m(svbool_t, svint16_t, uint64_t);
22386__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u8_m)))
22387svuint8_t svrshr_m(svbool_t, svuint8_t, uint64_t);
22388__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u32_m)))
22389svuint32_t svrshr_m(svbool_t, svuint32_t, uint64_t);
22390__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u64_m)))
22391svuint64_t svrshr_m(svbool_t, svuint64_t, uint64_t);
22392__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u16_m)))
22393svuint16_t svrshr_m(svbool_t, svuint16_t, uint64_t);
22394__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s8_x)))
22395svint8_t svrshr_x(svbool_t, svint8_t, uint64_t);
22396__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s32_x)))
22397svint32_t svrshr_x(svbool_t, svint32_t, uint64_t);
22398__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s64_x)))
22399svint64_t svrshr_x(svbool_t, svint64_t, uint64_t);
22400__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s16_x)))
22401svint16_t svrshr_x(svbool_t, svint16_t, uint64_t);
22402__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u8_x)))
22403svuint8_t svrshr_x(svbool_t, svuint8_t, uint64_t);
22404__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u32_x)))
22405svuint32_t svrshr_x(svbool_t, svuint32_t, uint64_t);
22406__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u64_x)))
22407svuint64_t svrshr_x(svbool_t, svuint64_t, uint64_t);
22408__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u16_x)))
22409svuint16_t svrshr_x(svbool_t, svuint16_t, uint64_t);
22410__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s8_z)))
22411svint8_t svrshr_z(svbool_t, svint8_t, uint64_t);
22412__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s32_z)))
22413svint32_t svrshr_z(svbool_t, svint32_t, uint64_t);
22414__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s64_z)))
22415svint64_t svrshr_z(svbool_t, svint64_t, uint64_t);
22416__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s16_z)))
22417svint16_t svrshr_z(svbool_t, svint16_t, uint64_t);
22418__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u8_z)))
22419svuint8_t svrshr_z(svbool_t, svuint8_t, uint64_t);
22420__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u32_z)))
22421svuint32_t svrshr_z(svbool_t, svuint32_t, uint64_t);
22422__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u64_z)))
22423svuint64_t svrshr_z(svbool_t, svuint64_t, uint64_t);
22424__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u16_z)))
22425svuint16_t svrshr_z(svbool_t, svuint16_t, uint64_t);
22426__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnb_n_u32)))
22427svuint16_t svrshrnb(svuint32_t, uint64_t);
22428__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnb_n_u64)))
22429svuint32_t svrshrnb(svuint64_t, uint64_t);
22430__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnb_n_u16)))
22431svuint8_t svrshrnb(svuint16_t, uint64_t);
22432__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnb_n_s32)))
22433svint16_t svrshrnb(svint32_t, uint64_t);
22434__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnb_n_s64)))
22435svint32_t svrshrnb(svint64_t, uint64_t);
22436__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnb_n_s16)))
22437svint8_t svrshrnb(svint16_t, uint64_t);
22438__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnt_n_u32)))
22439svuint16_t svrshrnt(svuint16_t, svuint32_t, uint64_t);
22440__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnt_n_u64)))
22441svuint32_t svrshrnt(svuint32_t, svuint64_t, uint64_t);
22442__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnt_n_u16)))
22443svuint8_t svrshrnt(svuint8_t, svuint16_t, uint64_t);
22444__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnt_n_s32)))
22445svint16_t svrshrnt(svint16_t, svint32_t, uint64_t);
22446__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnt_n_s64)))
22447svint32_t svrshrnt(svint32_t, svint64_t, uint64_t);
22448__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnt_n_s16)))
22449svint8_t svrshrnt(svint8_t, svint16_t, uint64_t);
22450__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsqrte_u32_m)))
22451svuint32_t svrsqrte_m(svuint32_t, svbool_t, svuint32_t);
22452__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsqrte_u32_x)))
22453svuint32_t svrsqrte_x(svbool_t, svuint32_t);
22454__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsqrte_u32_z)))
22455svuint32_t svrsqrte_z(svbool_t, svuint32_t);
22456__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_s8)))
22457svint8_t svrsra(svint8_t, svint8_t, uint64_t);
22458__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_s32)))
22459svint32_t svrsra(svint32_t, svint32_t, uint64_t);
22460__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_s64)))
22461svint64_t svrsra(svint64_t, svint64_t, uint64_t);
22462__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_s16)))
22463svint16_t svrsra(svint16_t, svint16_t, uint64_t);
22464__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_u8)))
22465svuint8_t svrsra(svuint8_t, svuint8_t, uint64_t);
22466__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_u32)))
22467svuint32_t svrsra(svuint32_t, svuint32_t, uint64_t);
22468__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_u64)))
22469svuint64_t svrsra(svuint64_t, svuint64_t, uint64_t);
22470__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_u16)))
22471svuint16_t svrsra(svuint16_t, svuint16_t, uint64_t);
22472__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_n_u32)))
22473svuint16_t svrsubhnb(svuint32_t, uint32_t);
22474__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_n_u64)))
22475svuint32_t svrsubhnb(svuint64_t, uint64_t);
22476__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_n_u16)))
22477svuint8_t svrsubhnb(svuint16_t, uint16_t);
22478__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_n_s32)))
22479svint16_t svrsubhnb(svint32_t, int32_t);
22480__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_n_s64)))
22481svint32_t svrsubhnb(svint64_t, int64_t);
22482__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_n_s16)))
22483svint8_t svrsubhnb(svint16_t, int16_t);
22484__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_u32)))
22485svuint16_t svrsubhnb(svuint32_t, svuint32_t);
22486__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_u64)))
22487svuint32_t svrsubhnb(svuint64_t, svuint64_t);
22488__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_u16)))
22489svuint8_t svrsubhnb(svuint16_t, svuint16_t);
22490__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_s32)))
22491svint16_t svrsubhnb(svint32_t, svint32_t);
22492__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_s64)))
22493svint32_t svrsubhnb(svint64_t, svint64_t);
22494__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_s16)))
22495svint8_t svrsubhnb(svint16_t, svint16_t);
22496__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_n_u32)))
22497svuint16_t svrsubhnt(svuint16_t, svuint32_t, uint32_t);
22498__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_n_u64)))
22499svuint32_t svrsubhnt(svuint32_t, svuint64_t, uint64_t);
22500__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_n_u16)))
22501svuint8_t svrsubhnt(svuint8_t, svuint16_t, uint16_t);
22502__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_n_s32)))
22503svint16_t svrsubhnt(svint16_t, svint32_t, int32_t);
22504__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_n_s64)))
22505svint32_t svrsubhnt(svint32_t, svint64_t, int64_t);
22506__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_n_s16)))
22507svint8_t svrsubhnt(svint8_t, svint16_t, int16_t);
22508__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_u32)))
22509svuint16_t svrsubhnt(svuint16_t, svuint32_t, svuint32_t);
22510__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_u64)))
22511svuint32_t svrsubhnt(svuint32_t, svuint64_t, svuint64_t);
22512__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_u16)))
22513svuint8_t svrsubhnt(svuint8_t, svuint16_t, svuint16_t);
22514__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_s32)))
22515svint16_t svrsubhnt(svint16_t, svint32_t, svint32_t);
22516__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_s64)))
22517svint32_t svrsubhnt(svint32_t, svint64_t, svint64_t);
22518__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_s16)))
22519svint8_t svrsubhnt(svint8_t, svint16_t, svint16_t);
22520__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclb_n_u32)))
22521svuint32_t svsbclb(svuint32_t, svuint32_t, uint32_t);
22522__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclb_n_u64)))
22523svuint64_t svsbclb(svuint64_t, svuint64_t, uint64_t);
22524__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclb_u32)))
22525svuint32_t svsbclb(svuint32_t, svuint32_t, svuint32_t);
22526__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclb_u64)))
22527svuint64_t svsbclb(svuint64_t, svuint64_t, svuint64_t);
22528__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclt_n_u32)))
22529svuint32_t svsbclt(svuint32_t, svuint32_t, uint32_t);
22530__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclt_n_u64)))
22531svuint64_t svsbclt(svuint64_t, svuint64_t, uint64_t);
22532__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclt_u32)))
22533svuint32_t svsbclt(svuint32_t, svuint32_t, svuint32_t);
22534__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclt_u64)))
22535svuint64_t svsbclt(svuint64_t, svuint64_t, svuint64_t);
22536__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllb_n_s32)))
22537svint32_t svshllb(svint16_t, uint64_t);
22538__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllb_n_s64)))
22539svint64_t svshllb(svint32_t, uint64_t);
22540__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllb_n_s16)))
22541svint16_t svshllb(svint8_t, uint64_t);
22542__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllb_n_u32)))
22543svuint32_t svshllb(svuint16_t, uint64_t);
22544__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllb_n_u64)))
22545svuint64_t svshllb(svuint32_t, uint64_t);
22546__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllb_n_u16)))
22547svuint16_t svshllb(svuint8_t, uint64_t);
22548__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllt_n_s32)))
22549svint32_t svshllt(svint16_t, uint64_t);
22550__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllt_n_s64)))
22551svint64_t svshllt(svint32_t, uint64_t);
22552__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllt_n_s16)))
22553svint16_t svshllt(svint8_t, uint64_t);
22554__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllt_n_u32)))
22555svuint32_t svshllt(svuint16_t, uint64_t);
22556__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllt_n_u64)))
22557svuint64_t svshllt(svuint32_t, uint64_t);
22558__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllt_n_u16)))
22559svuint16_t svshllt(svuint8_t, uint64_t);
22560__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnb_n_u32)))
22561svuint16_t svshrnb(svuint32_t, uint64_t);
22562__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnb_n_u64)))
22563svuint32_t svshrnb(svuint64_t, uint64_t);
22564__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnb_n_u16)))
22565svuint8_t svshrnb(svuint16_t, uint64_t);
22566__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnb_n_s32)))
22567svint16_t svshrnb(svint32_t, uint64_t);
22568__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnb_n_s64)))
22569svint32_t svshrnb(svint64_t, uint64_t);
22570__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnb_n_s16)))
22571svint8_t svshrnb(svint16_t, uint64_t);
22572__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnt_n_u32)))
22573svuint16_t svshrnt(svuint16_t, svuint32_t, uint64_t);
22574__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnt_n_u64)))
22575svuint32_t svshrnt(svuint32_t, svuint64_t, uint64_t);
22576__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnt_n_u16)))
22577svuint8_t svshrnt(svuint8_t, svuint16_t, uint64_t);
22578__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnt_n_s32)))
22579svint16_t svshrnt(svint16_t, svint32_t, uint64_t);
22580__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnt_n_s64)))
22581svint32_t svshrnt(svint32_t, svint64_t, uint64_t);
22582__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnt_n_s16)))
22583svint8_t svshrnt(svint8_t, svint16_t, uint64_t);
22584__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_u8)))
22585svuint8_t svsli(svuint8_t, svuint8_t, uint64_t);
22586__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_u32)))
22587svuint32_t svsli(svuint32_t, svuint32_t, uint64_t);
22588__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_u64)))
22589svuint64_t svsli(svuint64_t, svuint64_t, uint64_t);
22590__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_u16)))
22591svuint16_t svsli(svuint16_t, svuint16_t, uint64_t);
22592__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_s8)))
22593svint8_t svsli(svint8_t, svint8_t, uint64_t);
22594__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_s32)))
22595svint32_t svsli(svint32_t, svint32_t, uint64_t);
22596__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_s64)))
22597svint64_t svsli(svint64_t, svint64_t, uint64_t);
22598__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_s16)))
22599svint16_t svsli(svint16_t, svint16_t, uint64_t);
22600__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u8_m)))
22601svuint8_t svsqadd_m(svbool_t, svuint8_t, int8_t);
22602__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u32_m)))
22603svuint32_t svsqadd_m(svbool_t, svuint32_t, int32_t);
22604__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u64_m)))
22605svuint64_t svsqadd_m(svbool_t, svuint64_t, int64_t);
22606__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u16_m)))
22607svuint16_t svsqadd_m(svbool_t, svuint16_t, int16_t);
22608__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u8_x)))
22609svuint8_t svsqadd_x(svbool_t, svuint8_t, int8_t);
22610__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u32_x)))
22611svuint32_t svsqadd_x(svbool_t, svuint32_t, int32_t);
22612__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u64_x)))
22613svuint64_t svsqadd_x(svbool_t, svuint64_t, int64_t);
22614__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u16_x)))
22615svuint16_t svsqadd_x(svbool_t, svuint16_t, int16_t);
22616__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u8_z)))
22617svuint8_t svsqadd_z(svbool_t, svuint8_t, int8_t);
22618__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u32_z)))
22619svuint32_t svsqadd_z(svbool_t, svuint32_t, int32_t);
22620__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u64_z)))
22621svuint64_t svsqadd_z(svbool_t, svuint64_t, int64_t);
22622__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u16_z)))
22623svuint16_t svsqadd_z(svbool_t, svuint16_t, int16_t);
22624__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u8_m)))
22625svuint8_t svsqadd_m(svbool_t, svuint8_t, svint8_t);
22626__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u32_m)))
22627svuint32_t svsqadd_m(svbool_t, svuint32_t, svint32_t);
22628__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u64_m)))
22629svuint64_t svsqadd_m(svbool_t, svuint64_t, svint64_t);
22630__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u16_m)))
22631svuint16_t svsqadd_m(svbool_t, svuint16_t, svint16_t);
22632__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u8_x)))
22633svuint8_t svsqadd_x(svbool_t, svuint8_t, svint8_t);
22634__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u32_x)))
22635svuint32_t svsqadd_x(svbool_t, svuint32_t, svint32_t);
22636__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u64_x)))
22637svuint64_t svsqadd_x(svbool_t, svuint64_t, svint64_t);
22638__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u16_x)))
22639svuint16_t svsqadd_x(svbool_t, svuint16_t, svint16_t);
22640__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u8_z)))
22641svuint8_t svsqadd_z(svbool_t, svuint8_t, svint8_t);
22642__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u32_z)))
22643svuint32_t svsqadd_z(svbool_t, svuint32_t, svint32_t);
22644__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u64_z)))
22645svuint64_t svsqadd_z(svbool_t, svuint64_t, svint64_t);
22646__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u16_z)))
22647svuint16_t svsqadd_z(svbool_t, svuint16_t, svint16_t);
22648__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_s8)))
22649svint8_t svsra(svint8_t, svint8_t, uint64_t);
22650__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_s32)))
22651svint32_t svsra(svint32_t, svint32_t, uint64_t);
22652__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_s64)))
22653svint64_t svsra(svint64_t, svint64_t, uint64_t);
22654__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_s16)))
22655svint16_t svsra(svint16_t, svint16_t, uint64_t);
22656__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_u8)))
22657svuint8_t svsra(svuint8_t, svuint8_t, uint64_t);
22658__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_u32)))
22659svuint32_t svsra(svuint32_t, svuint32_t, uint64_t);
22660__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_u64)))
22661svuint64_t svsra(svuint64_t, svuint64_t, uint64_t);
22662__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_u16)))
22663svuint16_t svsra(svuint16_t, svuint16_t, uint64_t);
22664__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_u8)))
22665svuint8_t svsri(svuint8_t, svuint8_t, uint64_t);
22666__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_u32)))
22667svuint32_t svsri(svuint32_t, svuint32_t, uint64_t);
22668__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_u64)))
22669svuint64_t svsri(svuint64_t, svuint64_t, uint64_t);
22670__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_u16)))
22671svuint16_t svsri(svuint16_t, svuint16_t, uint64_t);
22672__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_s8)))
22673svint8_t svsri(svint8_t, svint8_t, uint64_t);
22674__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_s32)))
22675svint32_t svsri(svint32_t, svint32_t, uint64_t);
22676__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_s64)))
22677svint64_t svsri(svint64_t, svint64_t, uint64_t);
22678__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_s16)))
22679svint16_t svsri(svint16_t, svint16_t, uint64_t);
22680__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_index_u32)))
22681void svstnt1_scatter_index(svbool_t, svuint32_t, int64_t, svuint32_t);
22682__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_index_u64)))
22683void svstnt1_scatter_index(svbool_t, svuint64_t, int64_t, svuint64_t);
22684__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_index_f64)))
22685void svstnt1_scatter_index(svbool_t, svuint64_t, int64_t, svfloat64_t);
22686__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_index_f32)))
22687void svstnt1_scatter_index(svbool_t, svuint32_t, int64_t, svfloat32_t);
22688__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_index_s32)))
22689void svstnt1_scatter_index(svbool_t, svuint32_t, int64_t, svint32_t);
22690__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_index_s64)))
22691void svstnt1_scatter_index(svbool_t, svuint64_t, int64_t, svint64_t);
22692__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_offset_u32)))
22693void svstnt1_scatter_offset(svbool_t, svuint32_t, int64_t, svuint32_t);
22694__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_offset_u64)))
22695void svstnt1_scatter_offset(svbool_t, svuint64_t, int64_t, svuint64_t);
22696__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_offset_f64)))
22697void svstnt1_scatter_offset(svbool_t, svuint64_t, int64_t, svfloat64_t);
22698__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_offset_f32)))
22699void svstnt1_scatter_offset(svbool_t, svuint32_t, int64_t, svfloat32_t);
22700__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_offset_s32)))
22701void svstnt1_scatter_offset(svbool_t, svuint32_t, int64_t, svint32_t);
22702__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_offset_s64)))
22703void svstnt1_scatter_offset(svbool_t, svuint64_t, int64_t, svint64_t);
22704__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_u32)))
22705void svstnt1_scatter(svbool_t, svuint32_t, svuint32_t);
22706__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_u64)))
22707void svstnt1_scatter(svbool_t, svuint64_t, svuint64_t);
22708__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_f64)))
22709void svstnt1_scatter(svbool_t, svuint64_t, svfloat64_t);
22710__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_f32)))
22711void svstnt1_scatter(svbool_t, svuint32_t, svfloat32_t);
22712__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_s32)))
22713void svstnt1_scatter(svbool_t, svuint32_t, svint32_t);
22714__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_s64)))
22715void svstnt1_scatter(svbool_t, svuint64_t, svint64_t);
22716__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_s64index_u64)))
22717void svstnt1_scatter_index(svbool_t, uint64_t *, svint64_t, svuint64_t);
22718__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_s64index_f64)))
22719void svstnt1_scatter_index(svbool_t, float64_t *, svint64_t, svfloat64_t);
22720__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_s64index_s64)))
22721void svstnt1_scatter_index(svbool_t, int64_t *, svint64_t, svint64_t);
22722__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64index_u64)))
22723void svstnt1_scatter_index(svbool_t, uint64_t *, svuint64_t, svuint64_t);
22724__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64index_f64)))
22725void svstnt1_scatter_index(svbool_t, float64_t *, svuint64_t, svfloat64_t);
22726__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64index_s64)))
22727void svstnt1_scatter_index(svbool_t, int64_t *, svuint64_t, svint64_t);
22728__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32offset_u32)))
22729void svstnt1_scatter_offset(svbool_t, uint32_t *, svuint32_t, svuint32_t);
22730__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32offset_f32)))
22731void svstnt1_scatter_offset(svbool_t, float32_t *, svuint32_t, svfloat32_t);
22732__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32offset_s32)))
22733void svstnt1_scatter_offset(svbool_t, int32_t *, svuint32_t, svint32_t);
22734__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_s64offset_u64)))
22735void svstnt1_scatter_offset(svbool_t, uint64_t *, svint64_t, svuint64_t);
22736__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_s64offset_f64)))
22737void svstnt1_scatter_offset(svbool_t, float64_t *, svint64_t, svfloat64_t);
22738__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_s64offset_s64)))
22739void svstnt1_scatter_offset(svbool_t, int64_t *, svint64_t, svint64_t);
22740__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64offset_u64)))
22741void svstnt1_scatter_offset(svbool_t, uint64_t *, svuint64_t, svuint64_t);
22742__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64offset_f64)))
22743void svstnt1_scatter_offset(svbool_t, float64_t *, svuint64_t, svfloat64_t);
22744__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64offset_s64)))
22745void svstnt1_scatter_offset(svbool_t, int64_t *, svuint64_t, svint64_t);
22746__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u32base_offset_u32)))
22747void svstnt1b_scatter_offset(svbool_t, svuint32_t, int64_t, svuint32_t);
22748__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u64base_offset_u64)))
22749void svstnt1b_scatter_offset(svbool_t, svuint64_t, int64_t, svuint64_t);
22750__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u32base_offset_s32)))
22751void svstnt1b_scatter_offset(svbool_t, svuint32_t, int64_t, svint32_t);
22752__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u64base_offset_s64)))
22753void svstnt1b_scatter_offset(svbool_t, svuint64_t, int64_t, svint64_t);
22754__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u32base_u32)))
22755void svstnt1b_scatter(svbool_t, svuint32_t, svuint32_t);
22756__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u64base_u64)))
22757void svstnt1b_scatter(svbool_t, svuint64_t, svuint64_t);
22758__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u32base_s32)))
22759void svstnt1b_scatter(svbool_t, svuint32_t, svint32_t);
22760__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u64base_s64)))
22761void svstnt1b_scatter(svbool_t, svuint64_t, svint64_t);
22762__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u32offset_s32)))
22763void svstnt1b_scatter_offset(svbool_t, int8_t *, svuint32_t, svint32_t);
22764__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u32offset_u32)))
22765void svstnt1b_scatter_offset(svbool_t, uint8_t *, svuint32_t, svuint32_t);
22766__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_s64offset_s64)))
22767void svstnt1b_scatter_offset(svbool_t, int8_t *, svint64_t, svint64_t);
22768__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_s64offset_u64)))
22769void svstnt1b_scatter_offset(svbool_t, uint8_t *, svint64_t, svuint64_t);
22770__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u64offset_s64)))
22771void svstnt1b_scatter_offset(svbool_t, int8_t *, svuint64_t, svint64_t);
22772__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u64offset_u64)))
22773void svstnt1b_scatter_offset(svbool_t, uint8_t *, svuint64_t, svuint64_t);
22774__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32base_index_u32)))
22775void svstnt1h_scatter_index(svbool_t, svuint32_t, int64_t, svuint32_t);
22776__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64base_index_u64)))
22777void svstnt1h_scatter_index(svbool_t, svuint64_t, int64_t, svuint64_t);
22778__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32base_index_s32)))
22779void svstnt1h_scatter_index(svbool_t, svuint32_t, int64_t, svint32_t);
22780__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64base_index_s64)))
22781void svstnt1h_scatter_index(svbool_t, svuint64_t, int64_t, svint64_t);
22782__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32base_offset_u32)))
22783void svstnt1h_scatter_offset(svbool_t, svuint32_t, int64_t, svuint32_t);
22784__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64base_offset_u64)))
22785void svstnt1h_scatter_offset(svbool_t, svuint64_t, int64_t, svuint64_t);
22786__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32base_offset_s32)))
22787void svstnt1h_scatter_offset(svbool_t, svuint32_t, int64_t, svint32_t);
22788__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64base_offset_s64)))
22789void svstnt1h_scatter_offset(svbool_t, svuint64_t, int64_t, svint64_t);
22790__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32base_u32)))
22791void svstnt1h_scatter(svbool_t, svuint32_t, svuint32_t);
22792__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64base_u64)))
22793void svstnt1h_scatter(svbool_t, svuint64_t, svuint64_t);
22794__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32base_s32)))
22795void svstnt1h_scatter(svbool_t, svuint32_t, svint32_t);
22796__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64base_s64)))
22797void svstnt1h_scatter(svbool_t, svuint64_t, svint64_t);
22798__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_s64index_s64)))
22799void svstnt1h_scatter_index(svbool_t, int16_t *, svint64_t, svint64_t);
22800__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_s64index_u64)))
22801void svstnt1h_scatter_index(svbool_t, uint16_t *, svint64_t, svuint64_t);
22802__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64index_s64)))
22803void svstnt1h_scatter_index(svbool_t, int16_t *, svuint64_t, svint64_t);
22804__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64index_u64)))
22805void svstnt1h_scatter_index(svbool_t, uint16_t *, svuint64_t, svuint64_t);
22806__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32offset_s32)))
22807void svstnt1h_scatter_offset(svbool_t, int16_t *, svuint32_t, svint32_t);
22808__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32offset_u32)))
22809void svstnt1h_scatter_offset(svbool_t, uint16_t *, svuint32_t, svuint32_t);
22810__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_s64offset_s64)))
22811void svstnt1h_scatter_offset(svbool_t, int16_t *, svint64_t, svint64_t);
22812__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_s64offset_u64)))
22813void svstnt1h_scatter_offset(svbool_t, uint16_t *, svint64_t, svuint64_t);
22814__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64offset_s64)))
22815void svstnt1h_scatter_offset(svbool_t, int16_t *, svuint64_t, svint64_t);
22816__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64offset_u64)))
22817void svstnt1h_scatter_offset(svbool_t, uint16_t *, svuint64_t, svuint64_t);
22818__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64base_index_u64)))
22819void svstnt1w_scatter_index(svbool_t, svuint64_t, int64_t, svuint64_t);
22820__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64base_index_s64)))
22821void svstnt1w_scatter_index(svbool_t, svuint64_t, int64_t, svint64_t);
22822__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64base_offset_u64)))
22823void svstnt1w_scatter_offset(svbool_t, svuint64_t, int64_t, svuint64_t);
22824__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64base_offset_s64)))
22825void svstnt1w_scatter_offset(svbool_t, svuint64_t, int64_t, svint64_t);
22826__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64base_u64)))
22827void svstnt1w_scatter(svbool_t, svuint64_t, svuint64_t);
22828__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64base_s64)))
22829void svstnt1w_scatter(svbool_t, svuint64_t, svint64_t);
22830__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_s64index_s64)))
22831void svstnt1w_scatter_index(svbool_t, int32_t *, svint64_t, svint64_t);
22832__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_s64index_u64)))
22833void svstnt1w_scatter_index(svbool_t, uint32_t *, svint64_t, svuint64_t);
22834__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64index_s64)))
22835void svstnt1w_scatter_index(svbool_t, int32_t *, svuint64_t, svint64_t);
22836__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64index_u64)))
22837void svstnt1w_scatter_index(svbool_t, uint32_t *, svuint64_t, svuint64_t);
22838__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_s64offset_s64)))
22839void svstnt1w_scatter_offset(svbool_t, int32_t *, svint64_t, svint64_t);
22840__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_s64offset_u64)))
22841void svstnt1w_scatter_offset(svbool_t, uint32_t *, svint64_t, svuint64_t);
22842__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64offset_s64)))
22843void svstnt1w_scatter_offset(svbool_t, int32_t *, svuint64_t, svint64_t);
22844__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64offset_u64)))
22845void svstnt1w_scatter_offset(svbool_t, uint32_t *, svuint64_t, svuint64_t);
22846__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_n_u32)))
22847svuint16_t svsubhnb(svuint32_t, uint32_t);
22848__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_n_u64)))
22849svuint32_t svsubhnb(svuint64_t, uint64_t);
22850__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_n_u16)))
22851svuint8_t svsubhnb(svuint16_t, uint16_t);
22852__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_n_s32)))
22853svint16_t svsubhnb(svint32_t, int32_t);
22854__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_n_s64)))
22855svint32_t svsubhnb(svint64_t, int64_t);
22856__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_n_s16)))
22857svint8_t svsubhnb(svint16_t, int16_t);
22858__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_u32)))
22859svuint16_t svsubhnb(svuint32_t, svuint32_t);
22860__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_u64)))
22861svuint32_t svsubhnb(svuint64_t, svuint64_t);
22862__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_u16)))
22863svuint8_t svsubhnb(svuint16_t, svuint16_t);
22864__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_s32)))
22865svint16_t svsubhnb(svint32_t, svint32_t);
22866__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_s64)))
22867svint32_t svsubhnb(svint64_t, svint64_t);
22868__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_s16)))
22869svint8_t svsubhnb(svint16_t, svint16_t);
22870__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_n_u32)))
22871svuint16_t svsubhnt(svuint16_t, svuint32_t, uint32_t);
22872__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_n_u64)))
22873svuint32_t svsubhnt(svuint32_t, svuint64_t, uint64_t);
22874__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_n_u16)))
22875svuint8_t svsubhnt(svuint8_t, svuint16_t, uint16_t);
22876__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_n_s32)))
22877svint16_t svsubhnt(svint16_t, svint32_t, int32_t);
22878__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_n_s64)))
22879svint32_t svsubhnt(svint32_t, svint64_t, int64_t);
22880__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_n_s16)))
22881svint8_t svsubhnt(svint8_t, svint16_t, int16_t);
22882__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_u32)))
22883svuint16_t svsubhnt(svuint16_t, svuint32_t, svuint32_t);
22884__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_u64)))
22885svuint32_t svsubhnt(svuint32_t, svuint64_t, svuint64_t);
22886__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_u16)))
22887svuint8_t svsubhnt(svuint8_t, svuint16_t, svuint16_t);
22888__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_s32)))
22889svint16_t svsubhnt(svint16_t, svint32_t, svint32_t);
22890__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_s64)))
22891svint32_t svsubhnt(svint32_t, svint64_t, svint64_t);
22892__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_s16)))
22893svint8_t svsubhnt(svint8_t, svint16_t, svint16_t);
22894__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_n_s32)))
22895svint32_t svsublb(svint16_t, int16_t);
22896__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_n_s64)))
22897svint64_t svsublb(svint32_t, int32_t);
22898__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_n_s16)))
22899svint16_t svsublb(svint8_t, int8_t);
22900__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_n_u32)))
22901svuint32_t svsublb(svuint16_t, uint16_t);
22902__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_n_u64)))
22903svuint64_t svsublb(svuint32_t, uint32_t);
22904__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_n_u16)))
22905svuint16_t svsublb(svuint8_t, uint8_t);
22906__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_s32)))
22907svint32_t svsublb(svint16_t, svint16_t);
22908__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_s64)))
22909svint64_t svsublb(svint32_t, svint32_t);
22910__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_s16)))
22911svint16_t svsublb(svint8_t, svint8_t);
22912__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_u32)))
22913svuint32_t svsublb(svuint16_t, svuint16_t);
22914__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_u64)))
22915svuint64_t svsublb(svuint32_t, svuint32_t);
22916__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_u16)))
22917svuint16_t svsublb(svuint8_t, svuint8_t);
22918__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublbt_n_s32)))
22919svint32_t svsublbt(svint16_t, int16_t);
22920__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublbt_n_s64)))
22921svint64_t svsublbt(svint32_t, int32_t);
22922__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublbt_n_s16)))
22923svint16_t svsublbt(svint8_t, int8_t);
22924__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublbt_s32)))
22925svint32_t svsublbt(svint16_t, svint16_t);
22926__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublbt_s64)))
22927svint64_t svsublbt(svint32_t, svint32_t);
22928__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublbt_s16)))
22929svint16_t svsublbt(svint8_t, svint8_t);
22930__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_n_s32)))
22931svint32_t svsublt(svint16_t, int16_t);
22932__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_n_s64)))
22933svint64_t svsublt(svint32_t, int32_t);
22934__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_n_s16)))
22935svint16_t svsublt(svint8_t, int8_t);
22936__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_n_u32)))
22937svuint32_t svsublt(svuint16_t, uint16_t);
22938__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_n_u64)))
22939svuint64_t svsublt(svuint32_t, uint32_t);
22940__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_n_u16)))
22941svuint16_t svsublt(svuint8_t, uint8_t);
22942__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_s32)))
22943svint32_t svsublt(svint16_t, svint16_t);
22944__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_s64)))
22945svint64_t svsublt(svint32_t, svint32_t);
22946__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_s16)))
22947svint16_t svsublt(svint8_t, svint8_t);
22948__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_u32)))
22949svuint32_t svsublt(svuint16_t, svuint16_t);
22950__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_u64)))
22951svuint64_t svsublt(svuint32_t, svuint32_t);
22952__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_u16)))
22953svuint16_t svsublt(svuint8_t, svuint8_t);
22954__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubltb_n_s32)))
22955svint32_t svsubltb(svint16_t, int16_t);
22956__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubltb_n_s64)))
22957svint64_t svsubltb(svint32_t, int32_t);
22958__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubltb_n_s16)))
22959svint16_t svsubltb(svint8_t, int8_t);
22960__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubltb_s32)))
22961svint32_t svsubltb(svint16_t, svint16_t);
22962__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubltb_s64)))
22963svint64_t svsubltb(svint32_t, svint32_t);
22964__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubltb_s16)))
22965svint16_t svsubltb(svint8_t, svint8_t);
22966__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_n_s32)))
22967svint32_t svsubwb(svint32_t, int16_t);
22968__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_n_s64)))
22969svint64_t svsubwb(svint64_t, int32_t);
22970__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_n_s16)))
22971svint16_t svsubwb(svint16_t, int8_t);
22972__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_n_u32)))
22973svuint32_t svsubwb(svuint32_t, uint16_t);
22974__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_n_u64)))
22975svuint64_t svsubwb(svuint64_t, uint32_t);
22976__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_n_u16)))
22977svuint16_t svsubwb(svuint16_t, uint8_t);
22978__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_s32)))
22979svint32_t svsubwb(svint32_t, svint16_t);
22980__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_s64)))
22981svint64_t svsubwb(svint64_t, svint32_t);
22982__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_s16)))
22983svint16_t svsubwb(svint16_t, svint8_t);
22984__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_u32)))
22985svuint32_t svsubwb(svuint32_t, svuint16_t);
22986__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_u64)))
22987svuint64_t svsubwb(svuint64_t, svuint32_t);
22988__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_u16)))
22989svuint16_t svsubwb(svuint16_t, svuint8_t);
22990__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_n_s32)))
22991svint32_t svsubwt(svint32_t, int16_t);
22992__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_n_s64)))
22993svint64_t svsubwt(svint64_t, int32_t);
22994__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_n_s16)))
22995svint16_t svsubwt(svint16_t, int8_t);
22996__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_n_u32)))
22997svuint32_t svsubwt(svuint32_t, uint16_t);
22998__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_n_u64)))
22999svuint64_t svsubwt(svuint64_t, uint32_t);
23000__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_n_u16)))
23001svuint16_t svsubwt(svuint16_t, uint8_t);
23002__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_s32)))
23003svint32_t svsubwt(svint32_t, svint16_t);
23004__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_s64)))
23005svint64_t svsubwt(svint64_t, svint32_t);
23006__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_s16)))
23007svint16_t svsubwt(svint16_t, svint8_t);
23008__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_u32)))
23009svuint32_t svsubwt(svuint32_t, svuint16_t);
23010__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_u64)))
23011svuint64_t svsubwt(svuint64_t, svuint32_t);
23012__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_u16)))
23013svuint16_t svsubwt(svuint16_t, svuint8_t);
23014__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_u8)))
23015svuint8_t svtbl2(svuint8x2_t, svuint8_t);
23016__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_u32)))
23017svuint32_t svtbl2(svuint32x2_t, svuint32_t);
23018__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_u64)))
23019svuint64_t svtbl2(svuint64x2_t, svuint64_t);
23020__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_u16)))
23021svuint16_t svtbl2(svuint16x2_t, svuint16_t);
23022__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_s8)))
23023svint8_t svtbl2(svint8x2_t, svuint8_t);
23024__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_f64)))
23025svfloat64_t svtbl2(svfloat64x2_t, svuint64_t);
23026__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_f32)))
23027svfloat32_t svtbl2(svfloat32x2_t, svuint32_t);
23028__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_f16)))
23029svfloat16_t svtbl2(svfloat16x2_t, svuint16_t);
23030__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_s32)))
23031svint32_t svtbl2(svint32x2_t, svuint32_t);
23032__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_s64)))
23033svint64_t svtbl2(svint64x2_t, svuint64_t);
23034__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_s16)))
23035svint16_t svtbl2(svint16x2_t, svuint16_t);
23036__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_u8)))
23037svuint8_t svtbx(svuint8_t, svuint8_t, svuint8_t);
23038__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_u32)))
23039svuint32_t svtbx(svuint32_t, svuint32_t, svuint32_t);
23040__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_u64)))
23041svuint64_t svtbx(svuint64_t, svuint64_t, svuint64_t);
23042__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_u16)))
23043svuint16_t svtbx(svuint16_t, svuint16_t, svuint16_t);
23044__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_s8)))
23045svint8_t svtbx(svint8_t, svint8_t, svuint8_t);
23046__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_f64)))
23047svfloat64_t svtbx(svfloat64_t, svfloat64_t, svuint64_t);
23048__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_f32)))
23049svfloat32_t svtbx(svfloat32_t, svfloat32_t, svuint32_t);
23050__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_f16)))
23051svfloat16_t svtbx(svfloat16_t, svfloat16_t, svuint16_t);
23052__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_s32)))
23053svint32_t svtbx(svint32_t, svint32_t, svuint32_t);
23054__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_s64)))
23055svint64_t svtbx(svint64_t, svint64_t, svuint64_t);
23056__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_s16)))
23057svint16_t svtbx(svint16_t, svint16_t, svuint16_t);
23058__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s8_m)))
23059svint8_t svuqadd_m(svbool_t, svint8_t, uint8_t);
23060__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s32_m)))
23061svint32_t svuqadd_m(svbool_t, svint32_t, uint32_t);
23062__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s64_m)))
23063svint64_t svuqadd_m(svbool_t, svint64_t, uint64_t);
23064__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s16_m)))
23065svint16_t svuqadd_m(svbool_t, svint16_t, uint16_t);
23066__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s8_x)))
23067svint8_t svuqadd_x(svbool_t, svint8_t, uint8_t);
23068__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s32_x)))
23069svint32_t svuqadd_x(svbool_t, svint32_t, uint32_t);
23070__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s64_x)))
23071svint64_t svuqadd_x(svbool_t, svint64_t, uint64_t);
23072__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s16_x)))
23073svint16_t svuqadd_x(svbool_t, svint16_t, uint16_t);
23074__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s8_z)))
23075svint8_t svuqadd_z(svbool_t, svint8_t, uint8_t);
23076__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s32_z)))
23077svint32_t svuqadd_z(svbool_t, svint32_t, uint32_t);
23078__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s64_z)))
23079svint64_t svuqadd_z(svbool_t, svint64_t, uint64_t);
23080__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s16_z)))
23081svint16_t svuqadd_z(svbool_t, svint16_t, uint16_t);
23082__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s8_m)))
23083svint8_t svuqadd_m(svbool_t, svint8_t, svuint8_t);
23084__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s32_m)))
23085svint32_t svuqadd_m(svbool_t, svint32_t, svuint32_t);
23086__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s64_m)))
23087svint64_t svuqadd_m(svbool_t, svint64_t, svuint64_t);
23088__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s16_m)))
23089svint16_t svuqadd_m(svbool_t, svint16_t, svuint16_t);
23090__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s8_x)))
23091svint8_t svuqadd_x(svbool_t, svint8_t, svuint8_t);
23092__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s32_x)))
23093svint32_t svuqadd_x(svbool_t, svint32_t, svuint32_t);
23094__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s64_x)))
23095svint64_t svuqadd_x(svbool_t, svint64_t, svuint64_t);
23096__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s16_x)))
23097svint16_t svuqadd_x(svbool_t, svint16_t, svuint16_t);
23098__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s8_z)))
23099svint8_t svuqadd_z(svbool_t, svint8_t, svuint8_t);
23100__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s32_z)))
23101svint32_t svuqadd_z(svbool_t, svint32_t, svuint32_t);
23102__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s64_z)))
23103svint64_t svuqadd_z(svbool_t, svint64_t, svuint64_t);
23104__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s16_z)))
23105svint16_t svuqadd_z(svbool_t, svint16_t, svuint16_t);
23106__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b8_s32)))
23107svbool_t svwhilege_b8(int32_t, int32_t);
23108__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b32_s32)))
23109svbool_t svwhilege_b32(int32_t, int32_t);
23110__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b64_s32)))
23111svbool_t svwhilege_b64(int32_t, int32_t);
23112__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b16_s32)))
23113svbool_t svwhilege_b16(int32_t, int32_t);
23114__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b8_s64)))
23115svbool_t svwhilege_b8(int64_t, int64_t);
23116__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b32_s64)))
23117svbool_t svwhilege_b32(int64_t, int64_t);
23118__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b64_s64)))
23119svbool_t svwhilege_b64(int64_t, int64_t);
23120__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b16_s64)))
23121svbool_t svwhilege_b16(int64_t, int64_t);
23122__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b8_u32)))
23123svbool_t svwhilege_b8(uint32_t, uint32_t);
23124__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b32_u32)))
23125svbool_t svwhilege_b32(uint32_t, uint32_t);
23126__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b64_u32)))
23127svbool_t svwhilege_b64(uint32_t, uint32_t);
23128__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b16_u32)))
23129svbool_t svwhilege_b16(uint32_t, uint32_t);
23130__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b8_u64)))
23131svbool_t svwhilege_b8(uint64_t, uint64_t);
23132__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b32_u64)))
23133svbool_t svwhilege_b32(uint64_t, uint64_t);
23134__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b64_u64)))
23135svbool_t svwhilege_b64(uint64_t, uint64_t);
23136__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b16_u64)))
23137svbool_t svwhilege_b16(uint64_t, uint64_t);
23138__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b8_s32)))
23139svbool_t svwhilegt_b8(int32_t, int32_t);
23140__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b32_s32)))
23141svbool_t svwhilegt_b32(int32_t, int32_t);
23142__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b64_s32)))
23143svbool_t svwhilegt_b64(int32_t, int32_t);
23144__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b16_s32)))
23145svbool_t svwhilegt_b16(int32_t, int32_t);
23146__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b8_s64)))
23147svbool_t svwhilegt_b8(int64_t, int64_t);
23148__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b32_s64)))
23149svbool_t svwhilegt_b32(int64_t, int64_t);
23150__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b64_s64)))
23151svbool_t svwhilegt_b64(int64_t, int64_t);
23152__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b16_s64)))
23153svbool_t svwhilegt_b16(int64_t, int64_t);
23154__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b8_u32)))
23155svbool_t svwhilegt_b8(uint32_t, uint32_t);
23156__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b32_u32)))
23157svbool_t svwhilegt_b32(uint32_t, uint32_t);
23158__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b64_u32)))
23159svbool_t svwhilegt_b64(uint32_t, uint32_t);
23160__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b16_u32)))
23161svbool_t svwhilegt_b16(uint32_t, uint32_t);
23162__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b8_u64)))
23163svbool_t svwhilegt_b8(uint64_t, uint64_t);
23164__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b32_u64)))
23165svbool_t svwhilegt_b32(uint64_t, uint64_t);
23166__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b64_u64)))
23167svbool_t svwhilegt_b64(uint64_t, uint64_t);
23168__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b16_u64)))
23169svbool_t svwhilegt_b16(uint64_t, uint64_t);
23170__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_u8)))
23171svbool_t svwhilerw(uint8_t const *, uint8_t const *);
23172__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_s8)))
23173svbool_t svwhilerw(int8_t const *, int8_t const *);
23174__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_u64)))
23175svbool_t svwhilerw(uint64_t const *, uint64_t const *);
23176__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_f64)))
23177svbool_t svwhilerw(float64_t const *, float64_t const *);
23178__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_s64)))
23179svbool_t svwhilerw(int64_t const *, int64_t const *);
23180__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_u16)))
23181svbool_t svwhilerw(uint16_t const *, uint16_t const *);
23182__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_f16)))
23183svbool_t svwhilerw(float16_t const *, float16_t const *);
23184__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_s16)))
23185svbool_t svwhilerw(int16_t const *, int16_t const *);
23186__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_u32)))
23187svbool_t svwhilerw(uint32_t const *, uint32_t const *);
23188__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_f32)))
23189svbool_t svwhilerw(float32_t const *, float32_t const *);
23190__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_s32)))
23191svbool_t svwhilerw(int32_t const *, int32_t const *);
23192__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_u8)))
23193svbool_t svwhilewr(uint8_t const *, uint8_t const *);
23194__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_s8)))
23195svbool_t svwhilewr(int8_t const *, int8_t const *);
23196__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_u64)))
23197svbool_t svwhilewr(uint64_t const *, uint64_t const *);
23198__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_f64)))
23199svbool_t svwhilewr(float64_t const *, float64_t const *);
23200__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_s64)))
23201svbool_t svwhilewr(int64_t const *, int64_t const *);
23202__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_u16)))
23203svbool_t svwhilewr(uint16_t const *, uint16_t const *);
23204__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_f16)))
23205svbool_t svwhilewr(float16_t const *, float16_t const *);
23206__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_s16)))
23207svbool_t svwhilewr(int16_t const *, int16_t const *);
23208__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_u32)))
23209svbool_t svwhilewr(uint32_t const *, uint32_t const *);
23210__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_f32)))
23211svbool_t svwhilewr(float32_t const *, float32_t const *);
23212__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_s32)))
23213svbool_t svwhilewr(int32_t const *, int32_t const *);
23214__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_u8)))
23215svuint8_t svxar(svuint8_t, svuint8_t, uint64_t);
23216__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_u32)))
23217svuint32_t svxar(svuint32_t, svuint32_t, uint64_t);
23218__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_u64)))
23219svuint64_t svxar(svuint64_t, svuint64_t, uint64_t);
23220__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_u16)))
23221svuint16_t svxar(svuint16_t, svuint16_t, uint64_t);
23222__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_s8)))
23223svint8_t svxar(svint8_t, svint8_t, uint64_t);
23224__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_s32)))
23225svint32_t svxar(svint32_t, svint32_t, uint64_t);
23226__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_s64)))
23227svint64_t svxar(svint64_t, svint64_t, uint64_t);
23228__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_s16)))
23229svint16_t svxar(svint16_t, svint16_t, uint64_t);
23230#endif //defined(__ARM_FEATURE_SVE2)
23231
23232#if defined(__ARM_FEATURE_SVE2) && defined(__ARM_FEATURE_BF16_SCALAR_ARITHMETIC)
23233__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_bf16)))
23234svbool_t svwhilerw_bf16(bfloat16_t const *, bfloat16_t const *);
23235__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_bf16)))
23236svbool_t svwhilewr_bf16(bfloat16_t const *, bfloat16_t const *);
23237__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_bf16)))
23238svbool_t svwhilerw(bfloat16_t const *, bfloat16_t const *);
23239__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_bf16)))
23240svbool_t svwhilewr(bfloat16_t const *, bfloat16_t const *);
23241#endif //defined(__ARM_FEATURE_SVE2) && defined(__ARM_FEATURE_BF16_SCALAR_ARITHMETIC)
23242
23243#if defined(__ARM_FEATURE_SVE2) && defined(__ARM_FEATURE_SVE_BF16)
23244__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_bf16)))
23245svbfloat16_t svtbl2_bf16(svbfloat16x2_t, svuint16_t);
23246__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_bf16)))
23247svbfloat16_t svtbx_bf16(svbfloat16_t, svbfloat16_t, svuint16_t);
23248__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_bf16)))
23249svbfloat16_t svtbl2(svbfloat16x2_t, svuint16_t);
23250__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_bf16)))
23251svbfloat16_t svtbx(svbfloat16_t, svbfloat16_t, svuint16_t);
23252#endif //defined(__ARM_FEATURE_SVE2) && defined(__ARM_FEATURE_SVE_BF16)
23253
23254#if defined(__ARM_FEATURE_SVE2_AES)
23255__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaesd_u8)))
23256svuint8_t svaesd_u8(svuint8_t, svuint8_t);
23257__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaese_u8)))
23258svuint8_t svaese_u8(svuint8_t, svuint8_t);
23259__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaesimc_u8)))
23260svuint8_t svaesimc_u8(svuint8_t);
23261__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaesmc_u8)))
23262svuint8_t svaesmc_u8(svuint8_t);
23263__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_pair_n_u64)))
23264svuint64_t svpmullb_pair_n_u64(svuint64_t, uint64_t);
23265__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_pair_u64)))
23266svuint64_t svpmullb_pair_u64(svuint64_t, svuint64_t);
23267__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_pair_n_u64)))
23268svuint64_t svpmullt_pair_n_u64(svuint64_t, uint64_t);
23269__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_pair_u64)))
23270svuint64_t svpmullt_pair_u64(svuint64_t, svuint64_t);
23271__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaesd_u8)))
23272svuint8_t svaesd(svuint8_t, svuint8_t);
23273__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaese_u8)))
23274svuint8_t svaese(svuint8_t, svuint8_t);
23275__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaesimc_u8)))
23276svuint8_t svaesimc(svuint8_t);
23277__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaesmc_u8)))
23278svuint8_t svaesmc(svuint8_t);
23279__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_pair_n_u64)))
23280svuint64_t svpmullb_pair(svuint64_t, uint64_t);
23281__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_pair_u64)))
23282svuint64_t svpmullb_pair(svuint64_t, svuint64_t);
23283__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_pair_n_u64)))
23284svuint64_t svpmullt_pair(svuint64_t, uint64_t);
23285__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_pair_u64)))
23286svuint64_t svpmullt_pair(svuint64_t, svuint64_t);
23287#endif //defined(__ARM_FEATURE_SVE2_AES)
23288
23289#if defined(__ARM_FEATURE_SVE2_SHA3)
23290__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrax1_u64)))
23291svuint64_t svrax1_u64(svuint64_t, svuint64_t);
23292__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrax1_s64)))
23293svint64_t svrax1_s64(svint64_t, svint64_t);
23294__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrax1_u64)))
23295svuint64_t svrax1(svuint64_t, svuint64_t);
23296__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrax1_s64)))
23297svint64_t svrax1(svint64_t, svint64_t);
23298#endif //defined(__ARM_FEATURE_SVE2_SHA3)
23299
23300#if defined(__ARM_FEATURE_SVE2_SM4)
23301__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsm4e_u32)))
23302svuint32_t svsm4e_u32(svuint32_t, svuint32_t);
23303__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsm4ekey_u32)))
23304svuint32_t svsm4ekey_u32(svuint32_t, svuint32_t);
23305__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsm4e_u32)))
23306svuint32_t svsm4e(svuint32_t, svuint32_t);
23307__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsm4ekey_u32)))
23308svuint32_t svsm4ekey(svuint32_t, svuint32_t);
23309#endif //defined(__ARM_FEATURE_SVE2_SM4)
23310
23311#if defined(__ARM_FEATURE_SVE_BF16)
2331215593__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbfdot_n_f32)))
2331315594svfloat32_t svbfdot_n_f32(svfloat32_t, svbfloat16_t, bfloat16_t);
2331415595__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbfdot_f32)))
......@@ -23625,16 +15906,34 @@ __aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svzip1_bf16)))
2362515906svbfloat16_t svzip1(svbfloat16_t, svbfloat16_t);
2362615907__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svzip2_bf16)))
2362715908svbfloat16_t svzip2(svbfloat16_t, svbfloat16_t);
23628#endif //defined(__ARM_FEATURE_SVE_BF16)
23629
23630#if defined(__ARM_FEATURE_SVE_MATMUL_FP32)
15909__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtrn1q_bf16)))
15910svbfloat16_t svtrn1q_bf16(svbfloat16_t, svbfloat16_t);
15911__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtrn2q_bf16)))
15912svbfloat16_t svtrn2q_bf16(svbfloat16_t, svbfloat16_t);
15913__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuzp1q_bf16)))
15914svbfloat16_t svuzp1q_bf16(svbfloat16_t, svbfloat16_t);
15915__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuzp2q_bf16)))
15916svbfloat16_t svuzp2q_bf16(svbfloat16_t, svbfloat16_t);
15917__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svzip1q_bf16)))
15918svbfloat16_t svzip1q_bf16(svbfloat16_t, svbfloat16_t);
15919__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svzip2q_bf16)))
15920svbfloat16_t svzip2q_bf16(svbfloat16_t, svbfloat16_t);
15921__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtrn1q_bf16)))
15922svbfloat16_t svtrn1q(svbfloat16_t, svbfloat16_t);
15923__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtrn2q_bf16)))
15924svbfloat16_t svtrn2q(svbfloat16_t, svbfloat16_t);
15925__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuzp1q_bf16)))
15926svbfloat16_t svuzp1q(svbfloat16_t, svbfloat16_t);
15927__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuzp2q_bf16)))
15928svbfloat16_t svuzp2q(svbfloat16_t, svbfloat16_t);
15929__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svzip1q_bf16)))
15930svbfloat16_t svzip1q(svbfloat16_t, svbfloat16_t);
15931__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svzip2q_bf16)))
15932svbfloat16_t svzip2q(svbfloat16_t, svbfloat16_t);
2363115933__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmmla_f32)))
2363215934svfloat32_t svmmla_f32(svfloat32_t, svfloat32_t, svfloat32_t);
2363315935__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmmla_f32)))
2363415936svfloat32_t svmmla(svfloat32_t, svfloat32_t, svfloat32_t);
23635#endif //defined(__ARM_FEATURE_SVE_MATMUL_FP32)
23636
23637#if defined(__ARM_FEATURE_SVE_MATMUL_FP64)
2363815937__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svld1ro_u8)))
2363915938svuint8_t svld1ro_u8(svbool_t, uint8_t const *);
2364015939__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svld1ro_u32)))
......@@ -23947,40 +16246,10 @@ __aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svzip2q_s64)))
2394716246svint64_t svzip2q(svint64_t, svint64_t);
2394816247__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svzip2q_s16)))
2394916248svint16_t svzip2q(svint16_t, svint16_t);
23950#endif //defined(__ARM_FEATURE_SVE_MATMUL_FP64)
23951
23952#if defined(__ARM_FEATURE_SVE_MATMUL_FP64) && defined(__ARM_FEATURE_SVE_BF16)
2395316249__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svld1ro_bf16)))
2395416250svbfloat16_t svld1ro_bf16(svbool_t, bfloat16_t const *);
23955__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtrn1q_bf16)))
23956svbfloat16_t svtrn1q_bf16(svbfloat16_t, svbfloat16_t);
23957__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtrn2q_bf16)))
23958svbfloat16_t svtrn2q_bf16(svbfloat16_t, svbfloat16_t);
23959__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuzp1q_bf16)))
23960svbfloat16_t svuzp1q_bf16(svbfloat16_t, svbfloat16_t);
23961__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuzp2q_bf16)))
23962svbfloat16_t svuzp2q_bf16(svbfloat16_t, svbfloat16_t);
23963__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svzip1q_bf16)))
23964svbfloat16_t svzip1q_bf16(svbfloat16_t, svbfloat16_t);
23965__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svzip2q_bf16)))
23966svbfloat16_t svzip2q_bf16(svbfloat16_t, svbfloat16_t);
2396716251__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svld1ro_bf16)))
2396816252svbfloat16_t svld1ro(svbool_t, bfloat16_t const *);
23969__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtrn1q_bf16)))
23970svbfloat16_t svtrn1q(svbfloat16_t, svbfloat16_t);
23971__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtrn2q_bf16)))
23972svbfloat16_t svtrn2q(svbfloat16_t, svbfloat16_t);
23973__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuzp1q_bf16)))
23974svbfloat16_t svuzp1q(svbfloat16_t, svbfloat16_t);
23975__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuzp2q_bf16)))
23976svbfloat16_t svuzp2q(svbfloat16_t, svbfloat16_t);
23977__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svzip1q_bf16)))
23978svbfloat16_t svzip1q(svbfloat16_t, svbfloat16_t);
23979__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svzip2q_bf16)))
23980svbfloat16_t svzip2q(svbfloat16_t, svbfloat16_t);
23981#endif //defined(__ARM_FEATURE_SVE_MATMUL_FP64) && defined(__ARM_FEATURE_SVE_BF16)
23982
23983#if defined(__ARM_FEATURE_SVE_MATMUL_INT8)
2398416253__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmmla_s32)))
2398516254svint32_t svmmla_s32(svint32_t, svint8_t, svint8_t);
2398616255__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmmla_u32)))
......@@ -24017,13 +16286,7596 @@ __aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svusdot_lane_s32)))
2401716286svint32_t svusdot_lane(svint32_t, svuint8_t, svint8_t, uint64_t);
2401816287__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svusmmla_s32)))
2401916288svint32_t svusmmla(svint32_t, svuint8_t, svint8_t);
24020#endif //defined(__ARM_FEATURE_SVE_MATMUL_INT8)
24021#if defined(__ARM_FEATURE_SVE_BF16)
16289__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_s8)))
16290svint8_t svaba_n_s8(svint8_t, svint8_t, int8_t);
16291__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_s32)))
16292svint32_t svaba_n_s32(svint32_t, svint32_t, int32_t);
16293__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_s64)))
16294svint64_t svaba_n_s64(svint64_t, svint64_t, int64_t);
16295__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_s16)))
16296svint16_t svaba_n_s16(svint16_t, svint16_t, int16_t);
16297__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_u8)))
16298svuint8_t svaba_n_u8(svuint8_t, svuint8_t, uint8_t);
16299__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_u32)))
16300svuint32_t svaba_n_u32(svuint32_t, svuint32_t, uint32_t);
16301__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_u64)))
16302svuint64_t svaba_n_u64(svuint64_t, svuint64_t, uint64_t);
16303__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_u16)))
16304svuint16_t svaba_n_u16(svuint16_t, svuint16_t, uint16_t);
16305__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_s8)))
16306svint8_t svaba_s8(svint8_t, svint8_t, svint8_t);
16307__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_s32)))
16308svint32_t svaba_s32(svint32_t, svint32_t, svint32_t);
16309__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_s64)))
16310svint64_t svaba_s64(svint64_t, svint64_t, svint64_t);
16311__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_s16)))
16312svint16_t svaba_s16(svint16_t, svint16_t, svint16_t);
16313__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_u8)))
16314svuint8_t svaba_u8(svuint8_t, svuint8_t, svuint8_t);
16315__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_u32)))
16316svuint32_t svaba_u32(svuint32_t, svuint32_t, svuint32_t);
16317__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_u64)))
16318svuint64_t svaba_u64(svuint64_t, svuint64_t, svuint64_t);
16319__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_u16)))
16320svuint16_t svaba_u16(svuint16_t, svuint16_t, svuint16_t);
16321__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_n_s32)))
16322svint32_t svabalb_n_s32(svint32_t, svint16_t, int16_t);
16323__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_n_s64)))
16324svint64_t svabalb_n_s64(svint64_t, svint32_t, int32_t);
16325__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_n_s16)))
16326svint16_t svabalb_n_s16(svint16_t, svint8_t, int8_t);
16327__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_n_u32)))
16328svuint32_t svabalb_n_u32(svuint32_t, svuint16_t, uint16_t);
16329__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_n_u64)))
16330svuint64_t svabalb_n_u64(svuint64_t, svuint32_t, uint32_t);
16331__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_n_u16)))
16332svuint16_t svabalb_n_u16(svuint16_t, svuint8_t, uint8_t);
16333__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_s32)))
16334svint32_t svabalb_s32(svint32_t, svint16_t, svint16_t);
16335__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_s64)))
16336svint64_t svabalb_s64(svint64_t, svint32_t, svint32_t);
16337__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_s16)))
16338svint16_t svabalb_s16(svint16_t, svint8_t, svint8_t);
16339__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_u32)))
16340svuint32_t svabalb_u32(svuint32_t, svuint16_t, svuint16_t);
16341__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_u64)))
16342svuint64_t svabalb_u64(svuint64_t, svuint32_t, svuint32_t);
16343__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_u16)))
16344svuint16_t svabalb_u16(svuint16_t, svuint8_t, svuint8_t);
16345__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_n_s32)))
16346svint32_t svabalt_n_s32(svint32_t, svint16_t, int16_t);
16347__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_n_s64)))
16348svint64_t svabalt_n_s64(svint64_t, svint32_t, int32_t);
16349__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_n_s16)))
16350svint16_t svabalt_n_s16(svint16_t, svint8_t, int8_t);
16351__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_n_u32)))
16352svuint32_t svabalt_n_u32(svuint32_t, svuint16_t, uint16_t);
16353__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_n_u64)))
16354svuint64_t svabalt_n_u64(svuint64_t, svuint32_t, uint32_t);
16355__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_n_u16)))
16356svuint16_t svabalt_n_u16(svuint16_t, svuint8_t, uint8_t);
16357__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_s32)))
16358svint32_t svabalt_s32(svint32_t, svint16_t, svint16_t);
16359__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_s64)))
16360svint64_t svabalt_s64(svint64_t, svint32_t, svint32_t);
16361__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_s16)))
16362svint16_t svabalt_s16(svint16_t, svint8_t, svint8_t);
16363__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_u32)))
16364svuint32_t svabalt_u32(svuint32_t, svuint16_t, svuint16_t);
16365__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_u64)))
16366svuint64_t svabalt_u64(svuint64_t, svuint32_t, svuint32_t);
16367__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_u16)))
16368svuint16_t svabalt_u16(svuint16_t, svuint8_t, svuint8_t);
16369__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_n_s32)))
16370svint32_t svabdlb_n_s32(svint16_t, int16_t);
16371__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_n_s64)))
16372svint64_t svabdlb_n_s64(svint32_t, int32_t);
16373__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_n_s16)))
16374svint16_t svabdlb_n_s16(svint8_t, int8_t);
16375__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_n_u32)))
16376svuint32_t svabdlb_n_u32(svuint16_t, uint16_t);
16377__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_n_u64)))
16378svuint64_t svabdlb_n_u64(svuint32_t, uint32_t);
16379__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_n_u16)))
16380svuint16_t svabdlb_n_u16(svuint8_t, uint8_t);
16381__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_s32)))
16382svint32_t svabdlb_s32(svint16_t, svint16_t);
16383__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_s64)))
16384svint64_t svabdlb_s64(svint32_t, svint32_t);
16385__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_s16)))
16386svint16_t svabdlb_s16(svint8_t, svint8_t);
16387__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_u32)))
16388svuint32_t svabdlb_u32(svuint16_t, svuint16_t);
16389__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_u64)))
16390svuint64_t svabdlb_u64(svuint32_t, svuint32_t);
16391__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_u16)))
16392svuint16_t svabdlb_u16(svuint8_t, svuint8_t);
16393__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_n_s32)))
16394svint32_t svabdlt_n_s32(svint16_t, int16_t);
16395__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_n_s64)))
16396svint64_t svabdlt_n_s64(svint32_t, int32_t);
16397__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_n_s16)))
16398svint16_t svabdlt_n_s16(svint8_t, int8_t);
16399__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_n_u32)))
16400svuint32_t svabdlt_n_u32(svuint16_t, uint16_t);
16401__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_n_u64)))
16402svuint64_t svabdlt_n_u64(svuint32_t, uint32_t);
16403__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_n_u16)))
16404svuint16_t svabdlt_n_u16(svuint8_t, uint8_t);
16405__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_s32)))
16406svint32_t svabdlt_s32(svint16_t, svint16_t);
16407__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_s64)))
16408svint64_t svabdlt_s64(svint32_t, svint32_t);
16409__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_s16)))
16410svint16_t svabdlt_s16(svint8_t, svint8_t);
16411__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_u32)))
16412svuint32_t svabdlt_u32(svuint16_t, svuint16_t);
16413__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_u64)))
16414svuint64_t svabdlt_u64(svuint32_t, svuint32_t);
16415__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_u16)))
16416svuint16_t svabdlt_u16(svuint8_t, svuint8_t);
16417__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s32_m)))
16418svint32_t svadalp_s32_m(svbool_t, svint32_t, svint16_t);
16419__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s64_m)))
16420svint64_t svadalp_s64_m(svbool_t, svint64_t, svint32_t);
16421__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s16_m)))
16422svint16_t svadalp_s16_m(svbool_t, svint16_t, svint8_t);
16423__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s32_x)))
16424svint32_t svadalp_s32_x(svbool_t, svint32_t, svint16_t);
16425__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s64_x)))
16426svint64_t svadalp_s64_x(svbool_t, svint64_t, svint32_t);
16427__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s16_x)))
16428svint16_t svadalp_s16_x(svbool_t, svint16_t, svint8_t);
16429__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s32_z)))
16430svint32_t svadalp_s32_z(svbool_t, svint32_t, svint16_t);
16431__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s64_z)))
16432svint64_t svadalp_s64_z(svbool_t, svint64_t, svint32_t);
16433__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s16_z)))
16434svint16_t svadalp_s16_z(svbool_t, svint16_t, svint8_t);
16435__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u32_m)))
16436svuint32_t svadalp_u32_m(svbool_t, svuint32_t, svuint16_t);
16437__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u64_m)))
16438svuint64_t svadalp_u64_m(svbool_t, svuint64_t, svuint32_t);
16439__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u16_m)))
16440svuint16_t svadalp_u16_m(svbool_t, svuint16_t, svuint8_t);
16441__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u32_x)))
16442svuint32_t svadalp_u32_x(svbool_t, svuint32_t, svuint16_t);
16443__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u64_x)))
16444svuint64_t svadalp_u64_x(svbool_t, svuint64_t, svuint32_t);
16445__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u16_x)))
16446svuint16_t svadalp_u16_x(svbool_t, svuint16_t, svuint8_t);
16447__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u32_z)))
16448svuint32_t svadalp_u32_z(svbool_t, svuint32_t, svuint16_t);
16449__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u64_z)))
16450svuint64_t svadalp_u64_z(svbool_t, svuint64_t, svuint32_t);
16451__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u16_z)))
16452svuint16_t svadalp_u16_z(svbool_t, svuint16_t, svuint8_t);
16453__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclb_n_u32)))
16454svuint32_t svadclb_n_u32(svuint32_t, svuint32_t, uint32_t);
16455__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclb_n_u64)))
16456svuint64_t svadclb_n_u64(svuint64_t, svuint64_t, uint64_t);
16457__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclb_u32)))
16458svuint32_t svadclb_u32(svuint32_t, svuint32_t, svuint32_t);
16459__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclb_u64)))
16460svuint64_t svadclb_u64(svuint64_t, svuint64_t, svuint64_t);
16461__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclt_n_u32)))
16462svuint32_t svadclt_n_u32(svuint32_t, svuint32_t, uint32_t);
16463__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclt_n_u64)))
16464svuint64_t svadclt_n_u64(svuint64_t, svuint64_t, uint64_t);
16465__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclt_u32)))
16466svuint32_t svadclt_u32(svuint32_t, svuint32_t, svuint32_t);
16467__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclt_u64)))
16468svuint64_t svadclt_u64(svuint64_t, svuint64_t, svuint64_t);
16469__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_n_u32)))
16470svuint16_t svaddhnb_n_u32(svuint32_t, uint32_t);
16471__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_n_u64)))
16472svuint32_t svaddhnb_n_u64(svuint64_t, uint64_t);
16473__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_n_u16)))
16474svuint8_t svaddhnb_n_u16(svuint16_t, uint16_t);
16475__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_n_s32)))
16476svint16_t svaddhnb_n_s32(svint32_t, int32_t);
16477__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_n_s64)))
16478svint32_t svaddhnb_n_s64(svint64_t, int64_t);
16479__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_n_s16)))
16480svint8_t svaddhnb_n_s16(svint16_t, int16_t);
16481__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_u32)))
16482svuint16_t svaddhnb_u32(svuint32_t, svuint32_t);
16483__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_u64)))
16484svuint32_t svaddhnb_u64(svuint64_t, svuint64_t);
16485__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_u16)))
16486svuint8_t svaddhnb_u16(svuint16_t, svuint16_t);
16487__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_s32)))
16488svint16_t svaddhnb_s32(svint32_t, svint32_t);
16489__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_s64)))
16490svint32_t svaddhnb_s64(svint64_t, svint64_t);
16491__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_s16)))
16492svint8_t svaddhnb_s16(svint16_t, svint16_t);
16493__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_n_u32)))
16494svuint16_t svaddhnt_n_u32(svuint16_t, svuint32_t, uint32_t);
16495__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_n_u64)))
16496svuint32_t svaddhnt_n_u64(svuint32_t, svuint64_t, uint64_t);
16497__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_n_u16)))
16498svuint8_t svaddhnt_n_u16(svuint8_t, svuint16_t, uint16_t);
16499__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_n_s32)))
16500svint16_t svaddhnt_n_s32(svint16_t, svint32_t, int32_t);
16501__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_n_s64)))
16502svint32_t svaddhnt_n_s64(svint32_t, svint64_t, int64_t);
16503__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_n_s16)))
16504svint8_t svaddhnt_n_s16(svint8_t, svint16_t, int16_t);
16505__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_u32)))
16506svuint16_t svaddhnt_u32(svuint16_t, svuint32_t, svuint32_t);
16507__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_u64)))
16508svuint32_t svaddhnt_u64(svuint32_t, svuint64_t, svuint64_t);
16509__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_u16)))
16510svuint8_t svaddhnt_u16(svuint8_t, svuint16_t, svuint16_t);
16511__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_s32)))
16512svint16_t svaddhnt_s32(svint16_t, svint32_t, svint32_t);
16513__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_s64)))
16514svint32_t svaddhnt_s64(svint32_t, svint64_t, svint64_t);
16515__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_s16)))
16516svint8_t svaddhnt_s16(svint8_t, svint16_t, svint16_t);
16517__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_n_s32)))
16518svint32_t svaddlb_n_s32(svint16_t, int16_t);
16519__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_n_s64)))
16520svint64_t svaddlb_n_s64(svint32_t, int32_t);
16521__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_n_s16)))
16522svint16_t svaddlb_n_s16(svint8_t, int8_t);
16523__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_n_u32)))
16524svuint32_t svaddlb_n_u32(svuint16_t, uint16_t);
16525__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_n_u64)))
16526svuint64_t svaddlb_n_u64(svuint32_t, uint32_t);
16527__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_n_u16)))
16528svuint16_t svaddlb_n_u16(svuint8_t, uint8_t);
16529__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_s32)))
16530svint32_t svaddlb_s32(svint16_t, svint16_t);
16531__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_s64)))
16532svint64_t svaddlb_s64(svint32_t, svint32_t);
16533__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_s16)))
16534svint16_t svaddlb_s16(svint8_t, svint8_t);
16535__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_u32)))
16536svuint32_t svaddlb_u32(svuint16_t, svuint16_t);
16537__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_u64)))
16538svuint64_t svaddlb_u64(svuint32_t, svuint32_t);
16539__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_u16)))
16540svuint16_t svaddlb_u16(svuint8_t, svuint8_t);
16541__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlbt_n_s32)))
16542svint32_t svaddlbt_n_s32(svint16_t, int16_t);
16543__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlbt_n_s64)))
16544svint64_t svaddlbt_n_s64(svint32_t, int32_t);
16545__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlbt_n_s16)))
16546svint16_t svaddlbt_n_s16(svint8_t, int8_t);
16547__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlbt_s32)))
16548svint32_t svaddlbt_s32(svint16_t, svint16_t);
16549__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlbt_s64)))
16550svint64_t svaddlbt_s64(svint32_t, svint32_t);
16551__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlbt_s16)))
16552svint16_t svaddlbt_s16(svint8_t, svint8_t);
16553__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_n_s32)))
16554svint32_t svaddlt_n_s32(svint16_t, int16_t);
16555__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_n_s64)))
16556svint64_t svaddlt_n_s64(svint32_t, int32_t);
16557__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_n_s16)))
16558svint16_t svaddlt_n_s16(svint8_t, int8_t);
16559__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_n_u32)))
16560svuint32_t svaddlt_n_u32(svuint16_t, uint16_t);
16561__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_n_u64)))
16562svuint64_t svaddlt_n_u64(svuint32_t, uint32_t);
16563__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_n_u16)))
16564svuint16_t svaddlt_n_u16(svuint8_t, uint8_t);
16565__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_s32)))
16566svint32_t svaddlt_s32(svint16_t, svint16_t);
16567__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_s64)))
16568svint64_t svaddlt_s64(svint32_t, svint32_t);
16569__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_s16)))
16570svint16_t svaddlt_s16(svint8_t, svint8_t);
16571__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_u32)))
16572svuint32_t svaddlt_u32(svuint16_t, svuint16_t);
16573__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_u64)))
16574svuint64_t svaddlt_u64(svuint32_t, svuint32_t);
16575__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_u16)))
16576svuint16_t svaddlt_u16(svuint8_t, svuint8_t);
16577__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_f64_m)))
16578svfloat64_t svaddp_f64_m(svbool_t, svfloat64_t, svfloat64_t);
16579__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_f32_m)))
16580svfloat32_t svaddp_f32_m(svbool_t, svfloat32_t, svfloat32_t);
16581__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_f16_m)))
16582svfloat16_t svaddp_f16_m(svbool_t, svfloat16_t, svfloat16_t);
16583__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_f64_x)))
16584svfloat64_t svaddp_f64_x(svbool_t, svfloat64_t, svfloat64_t);
16585__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_f32_x)))
16586svfloat32_t svaddp_f32_x(svbool_t, svfloat32_t, svfloat32_t);
16587__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_f16_x)))
16588svfloat16_t svaddp_f16_x(svbool_t, svfloat16_t, svfloat16_t);
16589__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u8_m)))
16590svuint8_t svaddp_u8_m(svbool_t, svuint8_t, svuint8_t);
16591__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u32_m)))
16592svuint32_t svaddp_u32_m(svbool_t, svuint32_t, svuint32_t);
16593__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u64_m)))
16594svuint64_t svaddp_u64_m(svbool_t, svuint64_t, svuint64_t);
16595__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u16_m)))
16596svuint16_t svaddp_u16_m(svbool_t, svuint16_t, svuint16_t);
16597__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s8_m)))
16598svint8_t svaddp_s8_m(svbool_t, svint8_t, svint8_t);
16599__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s32_m)))
16600svint32_t svaddp_s32_m(svbool_t, svint32_t, svint32_t);
16601__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s64_m)))
16602svint64_t svaddp_s64_m(svbool_t, svint64_t, svint64_t);
16603__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s16_m)))
16604svint16_t svaddp_s16_m(svbool_t, svint16_t, svint16_t);
16605__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u8_x)))
16606svuint8_t svaddp_u8_x(svbool_t, svuint8_t, svuint8_t);
16607__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u32_x)))
16608svuint32_t svaddp_u32_x(svbool_t, svuint32_t, svuint32_t);
16609__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u64_x)))
16610svuint64_t svaddp_u64_x(svbool_t, svuint64_t, svuint64_t);
16611__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u16_x)))
16612svuint16_t svaddp_u16_x(svbool_t, svuint16_t, svuint16_t);
16613__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s8_x)))
16614svint8_t svaddp_s8_x(svbool_t, svint8_t, svint8_t);
16615__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s32_x)))
16616svint32_t svaddp_s32_x(svbool_t, svint32_t, svint32_t);
16617__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s64_x)))
16618svint64_t svaddp_s64_x(svbool_t, svint64_t, svint64_t);
16619__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s16_x)))
16620svint16_t svaddp_s16_x(svbool_t, svint16_t, svint16_t);
16621__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_n_s32)))
16622svint32_t svaddwb_n_s32(svint32_t, int16_t);
16623__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_n_s64)))
16624svint64_t svaddwb_n_s64(svint64_t, int32_t);
16625__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_n_s16)))
16626svint16_t svaddwb_n_s16(svint16_t, int8_t);
16627__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_n_u32)))
16628svuint32_t svaddwb_n_u32(svuint32_t, uint16_t);
16629__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_n_u64)))
16630svuint64_t svaddwb_n_u64(svuint64_t, uint32_t);
16631__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_n_u16)))
16632svuint16_t svaddwb_n_u16(svuint16_t, uint8_t);
16633__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_s32)))
16634svint32_t svaddwb_s32(svint32_t, svint16_t);
16635__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_s64)))
16636svint64_t svaddwb_s64(svint64_t, svint32_t);
16637__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_s16)))
16638svint16_t svaddwb_s16(svint16_t, svint8_t);
16639__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_u32)))
16640svuint32_t svaddwb_u32(svuint32_t, svuint16_t);
16641__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_u64)))
16642svuint64_t svaddwb_u64(svuint64_t, svuint32_t);
16643__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_u16)))
16644svuint16_t svaddwb_u16(svuint16_t, svuint8_t);
16645__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_n_s32)))
16646svint32_t svaddwt_n_s32(svint32_t, int16_t);
16647__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_n_s64)))
16648svint64_t svaddwt_n_s64(svint64_t, int32_t);
16649__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_n_s16)))
16650svint16_t svaddwt_n_s16(svint16_t, int8_t);
16651__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_n_u32)))
16652svuint32_t svaddwt_n_u32(svuint32_t, uint16_t);
16653__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_n_u64)))
16654svuint64_t svaddwt_n_u64(svuint64_t, uint32_t);
16655__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_n_u16)))
16656svuint16_t svaddwt_n_u16(svuint16_t, uint8_t);
16657__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_s32)))
16658svint32_t svaddwt_s32(svint32_t, svint16_t);
16659__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_s64)))
16660svint64_t svaddwt_s64(svint64_t, svint32_t);
16661__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_s16)))
16662svint16_t svaddwt_s16(svint16_t, svint8_t);
16663__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_u32)))
16664svuint32_t svaddwt_u32(svuint32_t, svuint16_t);
16665__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_u64)))
16666svuint64_t svaddwt_u64(svuint64_t, svuint32_t);
16667__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_u16)))
16668svuint16_t svaddwt_u16(svuint16_t, svuint8_t);
16669__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_u8)))
16670svuint8_t svbcax_n_u8(svuint8_t, svuint8_t, uint8_t);
16671__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_u32)))
16672svuint32_t svbcax_n_u32(svuint32_t, svuint32_t, uint32_t);
16673__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_u64)))
16674svuint64_t svbcax_n_u64(svuint64_t, svuint64_t, uint64_t);
16675__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_u16)))
16676svuint16_t svbcax_n_u16(svuint16_t, svuint16_t, uint16_t);
16677__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_s8)))
16678svint8_t svbcax_n_s8(svint8_t, svint8_t, int8_t);
16679__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_s32)))
16680svint32_t svbcax_n_s32(svint32_t, svint32_t, int32_t);
16681__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_s64)))
16682svint64_t svbcax_n_s64(svint64_t, svint64_t, int64_t);
16683__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_s16)))
16684svint16_t svbcax_n_s16(svint16_t, svint16_t, int16_t);
16685__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_u8)))
16686svuint8_t svbcax_u8(svuint8_t, svuint8_t, svuint8_t);
16687__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_u32)))
16688svuint32_t svbcax_u32(svuint32_t, svuint32_t, svuint32_t);
16689__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_u64)))
16690svuint64_t svbcax_u64(svuint64_t, svuint64_t, svuint64_t);
16691__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_u16)))
16692svuint16_t svbcax_u16(svuint16_t, svuint16_t, svuint16_t);
16693__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_s8)))
16694svint8_t svbcax_s8(svint8_t, svint8_t, svint8_t);
16695__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_s32)))
16696svint32_t svbcax_s32(svint32_t, svint32_t, svint32_t);
16697__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_s64)))
16698svint64_t svbcax_s64(svint64_t, svint64_t, svint64_t);
16699__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_s16)))
16700svint16_t svbcax_s16(svint16_t, svint16_t, svint16_t);
16701__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_u8)))
16702svuint8_t svbsl1n_n_u8(svuint8_t, svuint8_t, uint8_t);
16703__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_u32)))
16704svuint32_t svbsl1n_n_u32(svuint32_t, svuint32_t, uint32_t);
16705__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_u64)))
16706svuint64_t svbsl1n_n_u64(svuint64_t, svuint64_t, uint64_t);
16707__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_u16)))
16708svuint16_t svbsl1n_n_u16(svuint16_t, svuint16_t, uint16_t);
16709__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_s8)))
16710svint8_t svbsl1n_n_s8(svint8_t, svint8_t, int8_t);
16711__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_s32)))
16712svint32_t svbsl1n_n_s32(svint32_t, svint32_t, int32_t);
16713__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_s64)))
16714svint64_t svbsl1n_n_s64(svint64_t, svint64_t, int64_t);
16715__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_s16)))
16716svint16_t svbsl1n_n_s16(svint16_t, svint16_t, int16_t);
16717__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_u8)))
16718svuint8_t svbsl1n_u8(svuint8_t, svuint8_t, svuint8_t);
16719__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_u32)))
16720svuint32_t svbsl1n_u32(svuint32_t, svuint32_t, svuint32_t);
16721__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_u64)))
16722svuint64_t svbsl1n_u64(svuint64_t, svuint64_t, svuint64_t);
16723__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_u16)))
16724svuint16_t svbsl1n_u16(svuint16_t, svuint16_t, svuint16_t);
16725__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_s8)))
16726svint8_t svbsl1n_s8(svint8_t, svint8_t, svint8_t);
16727__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_s32)))
16728svint32_t svbsl1n_s32(svint32_t, svint32_t, svint32_t);
16729__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_s64)))
16730svint64_t svbsl1n_s64(svint64_t, svint64_t, svint64_t);
16731__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_s16)))
16732svint16_t svbsl1n_s16(svint16_t, svint16_t, svint16_t);
16733__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_u8)))
16734svuint8_t svbsl2n_n_u8(svuint8_t, svuint8_t, uint8_t);
16735__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_u32)))
16736svuint32_t svbsl2n_n_u32(svuint32_t, svuint32_t, uint32_t);
16737__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_u64)))
16738svuint64_t svbsl2n_n_u64(svuint64_t, svuint64_t, uint64_t);
16739__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_u16)))
16740svuint16_t svbsl2n_n_u16(svuint16_t, svuint16_t, uint16_t);
16741__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_s8)))
16742svint8_t svbsl2n_n_s8(svint8_t, svint8_t, int8_t);
16743__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_s32)))
16744svint32_t svbsl2n_n_s32(svint32_t, svint32_t, int32_t);
16745__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_s64)))
16746svint64_t svbsl2n_n_s64(svint64_t, svint64_t, int64_t);
16747__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_s16)))
16748svint16_t svbsl2n_n_s16(svint16_t, svint16_t, int16_t);
16749__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_u8)))
16750svuint8_t svbsl2n_u8(svuint8_t, svuint8_t, svuint8_t);
16751__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_u32)))
16752svuint32_t svbsl2n_u32(svuint32_t, svuint32_t, svuint32_t);
16753__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_u64)))
16754svuint64_t svbsl2n_u64(svuint64_t, svuint64_t, svuint64_t);
16755__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_u16)))
16756svuint16_t svbsl2n_u16(svuint16_t, svuint16_t, svuint16_t);
16757__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_s8)))
16758svint8_t svbsl2n_s8(svint8_t, svint8_t, svint8_t);
16759__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_s32)))
16760svint32_t svbsl2n_s32(svint32_t, svint32_t, svint32_t);
16761__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_s64)))
16762svint64_t svbsl2n_s64(svint64_t, svint64_t, svint64_t);
16763__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_s16)))
16764svint16_t svbsl2n_s16(svint16_t, svint16_t, svint16_t);
16765__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_u8)))
16766svuint8_t svbsl_n_u8(svuint8_t, svuint8_t, uint8_t);
16767__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_u32)))
16768svuint32_t svbsl_n_u32(svuint32_t, svuint32_t, uint32_t);
16769__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_u64)))
16770svuint64_t svbsl_n_u64(svuint64_t, svuint64_t, uint64_t);
16771__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_u16)))
16772svuint16_t svbsl_n_u16(svuint16_t, svuint16_t, uint16_t);
16773__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_s8)))
16774svint8_t svbsl_n_s8(svint8_t, svint8_t, int8_t);
16775__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_s32)))
16776svint32_t svbsl_n_s32(svint32_t, svint32_t, int32_t);
16777__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_s64)))
16778svint64_t svbsl_n_s64(svint64_t, svint64_t, int64_t);
16779__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_s16)))
16780svint16_t svbsl_n_s16(svint16_t, svint16_t, int16_t);
16781__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_u8)))
16782svuint8_t svbsl_u8(svuint8_t, svuint8_t, svuint8_t);
16783__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_u32)))
16784svuint32_t svbsl_u32(svuint32_t, svuint32_t, svuint32_t);
16785__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_u64)))
16786svuint64_t svbsl_u64(svuint64_t, svuint64_t, svuint64_t);
16787__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_u16)))
16788svuint16_t svbsl_u16(svuint16_t, svuint16_t, svuint16_t);
16789__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_s8)))
16790svint8_t svbsl_s8(svint8_t, svint8_t, svint8_t);
16791__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_s32)))
16792svint32_t svbsl_s32(svint32_t, svint32_t, svint32_t);
16793__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_s64)))
16794svint64_t svbsl_s64(svint64_t, svint64_t, svint64_t);
16795__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_s16)))
16796svint16_t svbsl_s16(svint16_t, svint16_t, svint16_t);
16797__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_u8)))
16798svuint8_t svcadd_u8(svuint8_t, svuint8_t, uint64_t);
16799__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_u32)))
16800svuint32_t svcadd_u32(svuint32_t, svuint32_t, uint64_t);
16801__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_u64)))
16802svuint64_t svcadd_u64(svuint64_t, svuint64_t, uint64_t);
16803__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_u16)))
16804svuint16_t svcadd_u16(svuint16_t, svuint16_t, uint64_t);
16805__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_s8)))
16806svint8_t svcadd_s8(svint8_t, svint8_t, uint64_t);
16807__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_s32)))
16808svint32_t svcadd_s32(svint32_t, svint32_t, uint64_t);
16809__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_s64)))
16810svint64_t svcadd_s64(svint64_t, svint64_t, uint64_t);
16811__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_s16)))
16812svint16_t svcadd_s16(svint16_t, svint16_t, uint64_t);
16813__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcdot_s32)))
16814svint32_t svcdot_s32(svint32_t, svint8_t, svint8_t, uint64_t);
16815__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcdot_s64)))
16816svint64_t svcdot_s64(svint64_t, svint16_t, svint16_t, uint64_t);
16817__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcdot_lane_s32)))
16818svint32_t svcdot_lane_s32(svint32_t, svint8_t, svint8_t, uint64_t, uint64_t);
16819__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcdot_lane_s64)))
16820svint64_t svcdot_lane_s64(svint64_t, svint16_t, svint16_t, uint64_t, uint64_t);
16821__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_u8)))
16822svuint8_t svcmla_u8(svuint8_t, svuint8_t, svuint8_t, uint64_t);
16823__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_u32)))
16824svuint32_t svcmla_u32(svuint32_t, svuint32_t, svuint32_t, uint64_t);
16825__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_u64)))
16826svuint64_t svcmla_u64(svuint64_t, svuint64_t, svuint64_t, uint64_t);
16827__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_u16)))
16828svuint16_t svcmla_u16(svuint16_t, svuint16_t, svuint16_t, uint64_t);
16829__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_s8)))
16830svint8_t svcmla_s8(svint8_t, svint8_t, svint8_t, uint64_t);
16831__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_s32)))
16832svint32_t svcmla_s32(svint32_t, svint32_t, svint32_t, uint64_t);
16833__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_s64)))
16834svint64_t svcmla_s64(svint64_t, svint64_t, svint64_t, uint64_t);
16835__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_s16)))
16836svint16_t svcmla_s16(svint16_t, svint16_t, svint16_t, uint64_t);
16837__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_lane_u32)))
16838svuint32_t svcmla_lane_u32(svuint32_t, svuint32_t, svuint32_t, uint64_t, uint64_t);
16839__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_lane_u16)))
16840svuint16_t svcmla_lane_u16(svuint16_t, svuint16_t, svuint16_t, uint64_t, uint64_t);
16841__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_lane_s32)))
16842svint32_t svcmla_lane_s32(svint32_t, svint32_t, svint32_t, uint64_t, uint64_t);
16843__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_lane_s16)))
16844svint16_t svcmla_lane_s16(svint16_t, svint16_t, svint16_t, uint64_t, uint64_t);
16845__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtlt_f32_f16_m)))
16846svfloat32_t svcvtlt_f32_f16_m(svfloat32_t, svbool_t, svfloat16_t);
16847__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtlt_f32_f16_x)))
16848svfloat32_t svcvtlt_f32_f16_x(svbool_t, svfloat16_t);
16849__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtlt_f64_f32_m)))
16850svfloat64_t svcvtlt_f64_f32_m(svfloat64_t, svbool_t, svfloat32_t);
16851__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtlt_f64_f32_x)))
16852svfloat64_t svcvtlt_f64_f32_x(svbool_t, svfloat32_t);
16853__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtnt_f16_f32_m)))
16854svfloat16_t svcvtnt_f16_f32_m(svfloat16_t, svbool_t, svfloat32_t);
16855__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtnt_f32_f64_m)))
16856svfloat32_t svcvtnt_f32_f64_m(svfloat32_t, svbool_t, svfloat64_t);
16857__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtx_f32_f64_m)))
16858svfloat32_t svcvtx_f32_f64_m(svfloat32_t, svbool_t, svfloat64_t);
16859__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtx_f32_f64_x)))
16860svfloat32_t svcvtx_f32_f64_x(svbool_t, svfloat64_t);
16861__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtx_f32_f64_z)))
16862svfloat32_t svcvtx_f32_f64_z(svbool_t, svfloat64_t);
16863__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtxnt_f32_f64_m)))
16864svfloat32_t svcvtxnt_f32_f64_m(svfloat32_t, svbool_t, svfloat64_t);
16865__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_u8)))
16866svuint8_t sveor3_n_u8(svuint8_t, svuint8_t, uint8_t);
16867__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_u32)))
16868svuint32_t sveor3_n_u32(svuint32_t, svuint32_t, uint32_t);
16869__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_u64)))
16870svuint64_t sveor3_n_u64(svuint64_t, svuint64_t, uint64_t);
16871__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_u16)))
16872svuint16_t sveor3_n_u16(svuint16_t, svuint16_t, uint16_t);
16873__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_s8)))
16874svint8_t sveor3_n_s8(svint8_t, svint8_t, int8_t);
16875__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_s32)))
16876svint32_t sveor3_n_s32(svint32_t, svint32_t, int32_t);
16877__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_s64)))
16878svint64_t sveor3_n_s64(svint64_t, svint64_t, int64_t);
16879__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_s16)))
16880svint16_t sveor3_n_s16(svint16_t, svint16_t, int16_t);
16881__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_u8)))
16882svuint8_t sveor3_u8(svuint8_t, svuint8_t, svuint8_t);
16883__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_u32)))
16884svuint32_t sveor3_u32(svuint32_t, svuint32_t, svuint32_t);
16885__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_u64)))
16886svuint64_t sveor3_u64(svuint64_t, svuint64_t, svuint64_t);
16887__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_u16)))
16888svuint16_t sveor3_u16(svuint16_t, svuint16_t, svuint16_t);
16889__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_s8)))
16890svint8_t sveor3_s8(svint8_t, svint8_t, svint8_t);
16891__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_s32)))
16892svint32_t sveor3_s32(svint32_t, svint32_t, svint32_t);
16893__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_s64)))
16894svint64_t sveor3_s64(svint64_t, svint64_t, svint64_t);
16895__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_s16)))
16896svint16_t sveor3_s16(svint16_t, svint16_t, svint16_t);
16897__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_u8)))
16898svuint8_t sveorbt_n_u8(svuint8_t, svuint8_t, uint8_t);
16899__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_u32)))
16900svuint32_t sveorbt_n_u32(svuint32_t, svuint32_t, uint32_t);
16901__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_u64)))
16902svuint64_t sveorbt_n_u64(svuint64_t, svuint64_t, uint64_t);
16903__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_u16)))
16904svuint16_t sveorbt_n_u16(svuint16_t, svuint16_t, uint16_t);
16905__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_s8)))
16906svint8_t sveorbt_n_s8(svint8_t, svint8_t, int8_t);
16907__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_s32)))
16908svint32_t sveorbt_n_s32(svint32_t, svint32_t, int32_t);
16909__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_s64)))
16910svint64_t sveorbt_n_s64(svint64_t, svint64_t, int64_t);
16911__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_s16)))
16912svint16_t sveorbt_n_s16(svint16_t, svint16_t, int16_t);
16913__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_u8)))
16914svuint8_t sveorbt_u8(svuint8_t, svuint8_t, svuint8_t);
16915__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_u32)))
16916svuint32_t sveorbt_u32(svuint32_t, svuint32_t, svuint32_t);
16917__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_u64)))
16918svuint64_t sveorbt_u64(svuint64_t, svuint64_t, svuint64_t);
16919__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_u16)))
16920svuint16_t sveorbt_u16(svuint16_t, svuint16_t, svuint16_t);
16921__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_s8)))
16922svint8_t sveorbt_s8(svint8_t, svint8_t, svint8_t);
16923__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_s32)))
16924svint32_t sveorbt_s32(svint32_t, svint32_t, svint32_t);
16925__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_s64)))
16926svint64_t sveorbt_s64(svint64_t, svint64_t, svint64_t);
16927__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_s16)))
16928svint16_t sveorbt_s16(svint16_t, svint16_t, svint16_t);
16929__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_u8)))
16930svuint8_t sveortb_n_u8(svuint8_t, svuint8_t, uint8_t);
16931__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_u32)))
16932svuint32_t sveortb_n_u32(svuint32_t, svuint32_t, uint32_t);
16933__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_u64)))
16934svuint64_t sveortb_n_u64(svuint64_t, svuint64_t, uint64_t);
16935__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_u16)))
16936svuint16_t sveortb_n_u16(svuint16_t, svuint16_t, uint16_t);
16937__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_s8)))
16938svint8_t sveortb_n_s8(svint8_t, svint8_t, int8_t);
16939__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_s32)))
16940svint32_t sveortb_n_s32(svint32_t, svint32_t, int32_t);
16941__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_s64)))
16942svint64_t sveortb_n_s64(svint64_t, svint64_t, int64_t);
16943__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_s16)))
16944svint16_t sveortb_n_s16(svint16_t, svint16_t, int16_t);
16945__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_u8)))
16946svuint8_t sveortb_u8(svuint8_t, svuint8_t, svuint8_t);
16947__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_u32)))
16948svuint32_t sveortb_u32(svuint32_t, svuint32_t, svuint32_t);
16949__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_u64)))
16950svuint64_t sveortb_u64(svuint64_t, svuint64_t, svuint64_t);
16951__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_u16)))
16952svuint16_t sveortb_u16(svuint16_t, svuint16_t, svuint16_t);
16953__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_s8)))
16954svint8_t sveortb_s8(svint8_t, svint8_t, svint8_t);
16955__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_s32)))
16956svint32_t sveortb_s32(svint32_t, svint32_t, svint32_t);
16957__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_s64)))
16958svint64_t sveortb_s64(svint64_t, svint64_t, svint64_t);
16959__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_s16)))
16960svint16_t sveortb_s16(svint16_t, svint16_t, svint16_t);
16961__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s8_m)))
16962svint8_t svhadd_n_s8_m(svbool_t, svint8_t, int8_t);
16963__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s32_m)))
16964svint32_t svhadd_n_s32_m(svbool_t, svint32_t, int32_t);
16965__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s64_m)))
16966svint64_t svhadd_n_s64_m(svbool_t, svint64_t, int64_t);
16967__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s16_m)))
16968svint16_t svhadd_n_s16_m(svbool_t, svint16_t, int16_t);
16969__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s8_x)))
16970svint8_t svhadd_n_s8_x(svbool_t, svint8_t, int8_t);
16971__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s32_x)))
16972svint32_t svhadd_n_s32_x(svbool_t, svint32_t, int32_t);
16973__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s64_x)))
16974svint64_t svhadd_n_s64_x(svbool_t, svint64_t, int64_t);
16975__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s16_x)))
16976svint16_t svhadd_n_s16_x(svbool_t, svint16_t, int16_t);
16977__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s8_z)))
16978svint8_t svhadd_n_s8_z(svbool_t, svint8_t, int8_t);
16979__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s32_z)))
16980svint32_t svhadd_n_s32_z(svbool_t, svint32_t, int32_t);
16981__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s64_z)))
16982svint64_t svhadd_n_s64_z(svbool_t, svint64_t, int64_t);
16983__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s16_z)))
16984svint16_t svhadd_n_s16_z(svbool_t, svint16_t, int16_t);
16985__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u8_m)))
16986svuint8_t svhadd_n_u8_m(svbool_t, svuint8_t, uint8_t);
16987__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u32_m)))
16988svuint32_t svhadd_n_u32_m(svbool_t, svuint32_t, uint32_t);
16989__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u64_m)))
16990svuint64_t svhadd_n_u64_m(svbool_t, svuint64_t, uint64_t);
16991__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u16_m)))
16992svuint16_t svhadd_n_u16_m(svbool_t, svuint16_t, uint16_t);
16993__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u8_x)))
16994svuint8_t svhadd_n_u8_x(svbool_t, svuint8_t, uint8_t);
16995__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u32_x)))
16996svuint32_t svhadd_n_u32_x(svbool_t, svuint32_t, uint32_t);
16997__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u64_x)))
16998svuint64_t svhadd_n_u64_x(svbool_t, svuint64_t, uint64_t);
16999__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u16_x)))
17000svuint16_t svhadd_n_u16_x(svbool_t, svuint16_t, uint16_t);
17001__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u8_z)))
17002svuint8_t svhadd_n_u8_z(svbool_t, svuint8_t, uint8_t);
17003__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u32_z)))
17004svuint32_t svhadd_n_u32_z(svbool_t, svuint32_t, uint32_t);
17005__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u64_z)))
17006svuint64_t svhadd_n_u64_z(svbool_t, svuint64_t, uint64_t);
17007__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u16_z)))
17008svuint16_t svhadd_n_u16_z(svbool_t, svuint16_t, uint16_t);
17009__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s8_m)))
17010svint8_t svhadd_s8_m(svbool_t, svint8_t, svint8_t);
17011__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s32_m)))
17012svint32_t svhadd_s32_m(svbool_t, svint32_t, svint32_t);
17013__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s64_m)))
17014svint64_t svhadd_s64_m(svbool_t, svint64_t, svint64_t);
17015__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s16_m)))
17016svint16_t svhadd_s16_m(svbool_t, svint16_t, svint16_t);
17017__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s8_x)))
17018svint8_t svhadd_s8_x(svbool_t, svint8_t, svint8_t);
17019__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s32_x)))
17020svint32_t svhadd_s32_x(svbool_t, svint32_t, svint32_t);
17021__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s64_x)))
17022svint64_t svhadd_s64_x(svbool_t, svint64_t, svint64_t);
17023__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s16_x)))
17024svint16_t svhadd_s16_x(svbool_t, svint16_t, svint16_t);
17025__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s8_z)))
17026svint8_t svhadd_s8_z(svbool_t, svint8_t, svint8_t);
17027__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s32_z)))
17028svint32_t svhadd_s32_z(svbool_t, svint32_t, svint32_t);
17029__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s64_z)))
17030svint64_t svhadd_s64_z(svbool_t, svint64_t, svint64_t);
17031__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s16_z)))
17032svint16_t svhadd_s16_z(svbool_t, svint16_t, svint16_t);
17033__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u8_m)))
17034svuint8_t svhadd_u8_m(svbool_t, svuint8_t, svuint8_t);
17035__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u32_m)))
17036svuint32_t svhadd_u32_m(svbool_t, svuint32_t, svuint32_t);
17037__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u64_m)))
17038svuint64_t svhadd_u64_m(svbool_t, svuint64_t, svuint64_t);
17039__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u16_m)))
17040svuint16_t svhadd_u16_m(svbool_t, svuint16_t, svuint16_t);
17041__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u8_x)))
17042svuint8_t svhadd_u8_x(svbool_t, svuint8_t, svuint8_t);
17043__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u32_x)))
17044svuint32_t svhadd_u32_x(svbool_t, svuint32_t, svuint32_t);
17045__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u64_x)))
17046svuint64_t svhadd_u64_x(svbool_t, svuint64_t, svuint64_t);
17047__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u16_x)))
17048svuint16_t svhadd_u16_x(svbool_t, svuint16_t, svuint16_t);
17049__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u8_z)))
17050svuint8_t svhadd_u8_z(svbool_t, svuint8_t, svuint8_t);
17051__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u32_z)))
17052svuint32_t svhadd_u32_z(svbool_t, svuint32_t, svuint32_t);
17053__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u64_z)))
17054svuint64_t svhadd_u64_z(svbool_t, svuint64_t, svuint64_t);
17055__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u16_z)))
17056svuint16_t svhadd_u16_z(svbool_t, svuint16_t, svuint16_t);
17057__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhistcnt_u32_z)))
17058svuint32_t svhistcnt_u32_z(svbool_t, svuint32_t, svuint32_t);
17059__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhistcnt_u64_z)))
17060svuint64_t svhistcnt_u64_z(svbool_t, svuint64_t, svuint64_t);
17061__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhistcnt_s32_z)))
17062svuint32_t svhistcnt_s32_z(svbool_t, svint32_t, svint32_t);
17063__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhistcnt_s64_z)))
17064svuint64_t svhistcnt_s64_z(svbool_t, svint64_t, svint64_t);
17065__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhistseg_u8)))
17066svuint8_t svhistseg_u8(svuint8_t, svuint8_t);
17067__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhistseg_s8)))
17068svuint8_t svhistseg_s8(svint8_t, svint8_t);
17069__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s8_m)))
17070svint8_t svhsub_n_s8_m(svbool_t, svint8_t, int8_t);
17071__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s32_m)))
17072svint32_t svhsub_n_s32_m(svbool_t, svint32_t, int32_t);
17073__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s64_m)))
17074svint64_t svhsub_n_s64_m(svbool_t, svint64_t, int64_t);
17075__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s16_m)))
17076svint16_t svhsub_n_s16_m(svbool_t, svint16_t, int16_t);
17077__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s8_x)))
17078svint8_t svhsub_n_s8_x(svbool_t, svint8_t, int8_t);
17079__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s32_x)))
17080svint32_t svhsub_n_s32_x(svbool_t, svint32_t, int32_t);
17081__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s64_x)))
17082svint64_t svhsub_n_s64_x(svbool_t, svint64_t, int64_t);
17083__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s16_x)))
17084svint16_t svhsub_n_s16_x(svbool_t, svint16_t, int16_t);
17085__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s8_z)))
17086svint8_t svhsub_n_s8_z(svbool_t, svint8_t, int8_t);
17087__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s32_z)))
17088svint32_t svhsub_n_s32_z(svbool_t, svint32_t, int32_t);
17089__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s64_z)))
17090svint64_t svhsub_n_s64_z(svbool_t, svint64_t, int64_t);
17091__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s16_z)))
17092svint16_t svhsub_n_s16_z(svbool_t, svint16_t, int16_t);
17093__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u8_m)))
17094svuint8_t svhsub_n_u8_m(svbool_t, svuint8_t, uint8_t);
17095__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u32_m)))
17096svuint32_t svhsub_n_u32_m(svbool_t, svuint32_t, uint32_t);
17097__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u64_m)))
17098svuint64_t svhsub_n_u64_m(svbool_t, svuint64_t, uint64_t);
17099__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u16_m)))
17100svuint16_t svhsub_n_u16_m(svbool_t, svuint16_t, uint16_t);
17101__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u8_x)))
17102svuint8_t svhsub_n_u8_x(svbool_t, svuint8_t, uint8_t);
17103__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u32_x)))
17104svuint32_t svhsub_n_u32_x(svbool_t, svuint32_t, uint32_t);
17105__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u64_x)))
17106svuint64_t svhsub_n_u64_x(svbool_t, svuint64_t, uint64_t);
17107__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u16_x)))
17108svuint16_t svhsub_n_u16_x(svbool_t, svuint16_t, uint16_t);
17109__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u8_z)))
17110svuint8_t svhsub_n_u8_z(svbool_t, svuint8_t, uint8_t);
17111__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u32_z)))
17112svuint32_t svhsub_n_u32_z(svbool_t, svuint32_t, uint32_t);
17113__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u64_z)))
17114svuint64_t svhsub_n_u64_z(svbool_t, svuint64_t, uint64_t);
17115__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u16_z)))
17116svuint16_t svhsub_n_u16_z(svbool_t, svuint16_t, uint16_t);
17117__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s8_m)))
17118svint8_t svhsub_s8_m(svbool_t, svint8_t, svint8_t);
17119__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s32_m)))
17120svint32_t svhsub_s32_m(svbool_t, svint32_t, svint32_t);
17121__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s64_m)))
17122svint64_t svhsub_s64_m(svbool_t, svint64_t, svint64_t);
17123__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s16_m)))
17124svint16_t svhsub_s16_m(svbool_t, svint16_t, svint16_t);
17125__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s8_x)))
17126svint8_t svhsub_s8_x(svbool_t, svint8_t, svint8_t);
17127__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s32_x)))
17128svint32_t svhsub_s32_x(svbool_t, svint32_t, svint32_t);
17129__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s64_x)))
17130svint64_t svhsub_s64_x(svbool_t, svint64_t, svint64_t);
17131__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s16_x)))
17132svint16_t svhsub_s16_x(svbool_t, svint16_t, svint16_t);
17133__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s8_z)))
17134svint8_t svhsub_s8_z(svbool_t, svint8_t, svint8_t);
17135__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s32_z)))
17136svint32_t svhsub_s32_z(svbool_t, svint32_t, svint32_t);
17137__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s64_z)))
17138svint64_t svhsub_s64_z(svbool_t, svint64_t, svint64_t);
17139__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s16_z)))
17140svint16_t svhsub_s16_z(svbool_t, svint16_t, svint16_t);
17141__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u8_m)))
17142svuint8_t svhsub_u8_m(svbool_t, svuint8_t, svuint8_t);
17143__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u32_m)))
17144svuint32_t svhsub_u32_m(svbool_t, svuint32_t, svuint32_t);
17145__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u64_m)))
17146svuint64_t svhsub_u64_m(svbool_t, svuint64_t, svuint64_t);
17147__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u16_m)))
17148svuint16_t svhsub_u16_m(svbool_t, svuint16_t, svuint16_t);
17149__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u8_x)))
17150svuint8_t svhsub_u8_x(svbool_t, svuint8_t, svuint8_t);
17151__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u32_x)))
17152svuint32_t svhsub_u32_x(svbool_t, svuint32_t, svuint32_t);
17153__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u64_x)))
17154svuint64_t svhsub_u64_x(svbool_t, svuint64_t, svuint64_t);
17155__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u16_x)))
17156svuint16_t svhsub_u16_x(svbool_t, svuint16_t, svuint16_t);
17157__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u8_z)))
17158svuint8_t svhsub_u8_z(svbool_t, svuint8_t, svuint8_t);
17159__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u32_z)))
17160svuint32_t svhsub_u32_z(svbool_t, svuint32_t, svuint32_t);
17161__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u64_z)))
17162svuint64_t svhsub_u64_z(svbool_t, svuint64_t, svuint64_t);
17163__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u16_z)))
17164svuint16_t svhsub_u16_z(svbool_t, svuint16_t, svuint16_t);
17165__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s8_m)))
17166svint8_t svhsubr_n_s8_m(svbool_t, svint8_t, int8_t);
17167__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s32_m)))
17168svint32_t svhsubr_n_s32_m(svbool_t, svint32_t, int32_t);
17169__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s64_m)))
17170svint64_t svhsubr_n_s64_m(svbool_t, svint64_t, int64_t);
17171__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s16_m)))
17172svint16_t svhsubr_n_s16_m(svbool_t, svint16_t, int16_t);
17173__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s8_x)))
17174svint8_t svhsubr_n_s8_x(svbool_t, svint8_t, int8_t);
17175__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s32_x)))
17176svint32_t svhsubr_n_s32_x(svbool_t, svint32_t, int32_t);
17177__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s64_x)))
17178svint64_t svhsubr_n_s64_x(svbool_t, svint64_t, int64_t);
17179__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s16_x)))
17180svint16_t svhsubr_n_s16_x(svbool_t, svint16_t, int16_t);
17181__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s8_z)))
17182svint8_t svhsubr_n_s8_z(svbool_t, svint8_t, int8_t);
17183__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s32_z)))
17184svint32_t svhsubr_n_s32_z(svbool_t, svint32_t, int32_t);
17185__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s64_z)))
17186svint64_t svhsubr_n_s64_z(svbool_t, svint64_t, int64_t);
17187__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s16_z)))
17188svint16_t svhsubr_n_s16_z(svbool_t, svint16_t, int16_t);
17189__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u8_m)))
17190svuint8_t svhsubr_n_u8_m(svbool_t, svuint8_t, uint8_t);
17191__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u32_m)))
17192svuint32_t svhsubr_n_u32_m(svbool_t, svuint32_t, uint32_t);
17193__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u64_m)))
17194svuint64_t svhsubr_n_u64_m(svbool_t, svuint64_t, uint64_t);
17195__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u16_m)))
17196svuint16_t svhsubr_n_u16_m(svbool_t, svuint16_t, uint16_t);
17197__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u8_x)))
17198svuint8_t svhsubr_n_u8_x(svbool_t, svuint8_t, uint8_t);
17199__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u32_x)))
17200svuint32_t svhsubr_n_u32_x(svbool_t, svuint32_t, uint32_t);
17201__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u64_x)))
17202svuint64_t svhsubr_n_u64_x(svbool_t, svuint64_t, uint64_t);
17203__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u16_x)))
17204svuint16_t svhsubr_n_u16_x(svbool_t, svuint16_t, uint16_t);
17205__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u8_z)))
17206svuint8_t svhsubr_n_u8_z(svbool_t, svuint8_t, uint8_t);
17207__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u32_z)))
17208svuint32_t svhsubr_n_u32_z(svbool_t, svuint32_t, uint32_t);
17209__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u64_z)))
17210svuint64_t svhsubr_n_u64_z(svbool_t, svuint64_t, uint64_t);
17211__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u16_z)))
17212svuint16_t svhsubr_n_u16_z(svbool_t, svuint16_t, uint16_t);
17213__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s8_m)))
17214svint8_t svhsubr_s8_m(svbool_t, svint8_t, svint8_t);
17215__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s32_m)))
17216svint32_t svhsubr_s32_m(svbool_t, svint32_t, svint32_t);
17217__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s64_m)))
17218svint64_t svhsubr_s64_m(svbool_t, svint64_t, svint64_t);
17219__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s16_m)))
17220svint16_t svhsubr_s16_m(svbool_t, svint16_t, svint16_t);
17221__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s8_x)))
17222svint8_t svhsubr_s8_x(svbool_t, svint8_t, svint8_t);
17223__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s32_x)))
17224svint32_t svhsubr_s32_x(svbool_t, svint32_t, svint32_t);
17225__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s64_x)))
17226svint64_t svhsubr_s64_x(svbool_t, svint64_t, svint64_t);
17227__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s16_x)))
17228svint16_t svhsubr_s16_x(svbool_t, svint16_t, svint16_t);
17229__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s8_z)))
17230svint8_t svhsubr_s8_z(svbool_t, svint8_t, svint8_t);
17231__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s32_z)))
17232svint32_t svhsubr_s32_z(svbool_t, svint32_t, svint32_t);
17233__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s64_z)))
17234svint64_t svhsubr_s64_z(svbool_t, svint64_t, svint64_t);
17235__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s16_z)))
17236svint16_t svhsubr_s16_z(svbool_t, svint16_t, svint16_t);
17237__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u8_m)))
17238svuint8_t svhsubr_u8_m(svbool_t, svuint8_t, svuint8_t);
17239__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u32_m)))
17240svuint32_t svhsubr_u32_m(svbool_t, svuint32_t, svuint32_t);
17241__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u64_m)))
17242svuint64_t svhsubr_u64_m(svbool_t, svuint64_t, svuint64_t);
17243__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u16_m)))
17244svuint16_t svhsubr_u16_m(svbool_t, svuint16_t, svuint16_t);
17245__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u8_x)))
17246svuint8_t svhsubr_u8_x(svbool_t, svuint8_t, svuint8_t);
17247__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u32_x)))
17248svuint32_t svhsubr_u32_x(svbool_t, svuint32_t, svuint32_t);
17249__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u64_x)))
17250svuint64_t svhsubr_u64_x(svbool_t, svuint64_t, svuint64_t);
17251__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u16_x)))
17252svuint16_t svhsubr_u16_x(svbool_t, svuint16_t, svuint16_t);
17253__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u8_z)))
17254svuint8_t svhsubr_u8_z(svbool_t, svuint8_t, svuint8_t);
17255__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u32_z)))
17256svuint32_t svhsubr_u32_z(svbool_t, svuint32_t, svuint32_t);
17257__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u64_z)))
17258svuint64_t svhsubr_u64_z(svbool_t, svuint64_t, svuint64_t);
17259__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u16_z)))
17260svuint16_t svhsubr_u16_z(svbool_t, svuint16_t, svuint16_t);
17261__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_index_u32)))
17262svuint32_t svldnt1_gather_u32base_index_u32(svbool_t, svuint32_t, int64_t);
17263__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_index_u64)))
17264svuint64_t svldnt1_gather_u64base_index_u64(svbool_t, svuint64_t, int64_t);
17265__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_index_f64)))
17266svfloat64_t svldnt1_gather_u64base_index_f64(svbool_t, svuint64_t, int64_t);
17267__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_index_f32)))
17268svfloat32_t svldnt1_gather_u32base_index_f32(svbool_t, svuint32_t, int64_t);
17269__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_index_s32)))
17270svint32_t svldnt1_gather_u32base_index_s32(svbool_t, svuint32_t, int64_t);
17271__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_index_s64)))
17272svint64_t svldnt1_gather_u64base_index_s64(svbool_t, svuint64_t, int64_t);
17273__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_offset_u32)))
17274svuint32_t svldnt1_gather_u32base_offset_u32(svbool_t, svuint32_t, int64_t);
17275__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_offset_u64)))
17276svuint64_t svldnt1_gather_u64base_offset_u64(svbool_t, svuint64_t, int64_t);
17277__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_offset_f64)))
17278svfloat64_t svldnt1_gather_u64base_offset_f64(svbool_t, svuint64_t, int64_t);
17279__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_offset_f32)))
17280svfloat32_t svldnt1_gather_u32base_offset_f32(svbool_t, svuint32_t, int64_t);
17281__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_offset_s32)))
17282svint32_t svldnt1_gather_u32base_offset_s32(svbool_t, svuint32_t, int64_t);
17283__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_offset_s64)))
17284svint64_t svldnt1_gather_u64base_offset_s64(svbool_t, svuint64_t, int64_t);
17285__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_u32)))
17286svuint32_t svldnt1_gather_u32base_u32(svbool_t, svuint32_t);
17287__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_u64)))
17288svuint64_t svldnt1_gather_u64base_u64(svbool_t, svuint64_t);
17289__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_f64)))
17290svfloat64_t svldnt1_gather_u64base_f64(svbool_t, svuint64_t);
17291__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_f32)))
17292svfloat32_t svldnt1_gather_u32base_f32(svbool_t, svuint32_t);
17293__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_s32)))
17294svint32_t svldnt1_gather_u32base_s32(svbool_t, svuint32_t);
17295__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_s64)))
17296svint64_t svldnt1_gather_u64base_s64(svbool_t, svuint64_t);
17297__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_s64index_u64)))
17298svuint64_t svldnt1_gather_s64index_u64(svbool_t, uint64_t const *, svint64_t);
17299__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_s64index_f64)))
17300svfloat64_t svldnt1_gather_s64index_f64(svbool_t, float64_t const *, svint64_t);
17301__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_s64index_s64)))
17302svint64_t svldnt1_gather_s64index_s64(svbool_t, int64_t const *, svint64_t);
17303__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64index_u64)))
17304svuint64_t svldnt1_gather_u64index_u64(svbool_t, uint64_t const *, svuint64_t);
17305__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64index_f64)))
17306svfloat64_t svldnt1_gather_u64index_f64(svbool_t, float64_t const *, svuint64_t);
17307__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64index_s64)))
17308svint64_t svldnt1_gather_u64index_s64(svbool_t, int64_t const *, svuint64_t);
17309__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32offset_u32)))
17310svuint32_t svldnt1_gather_u32offset_u32(svbool_t, uint32_t const *, svuint32_t);
17311__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32offset_f32)))
17312svfloat32_t svldnt1_gather_u32offset_f32(svbool_t, float32_t const *, svuint32_t);
17313__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32offset_s32)))
17314svint32_t svldnt1_gather_u32offset_s32(svbool_t, int32_t const *, svuint32_t);
17315__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_s64offset_u64)))
17316svuint64_t svldnt1_gather_s64offset_u64(svbool_t, uint64_t const *, svint64_t);
17317__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_s64offset_f64)))
17318svfloat64_t svldnt1_gather_s64offset_f64(svbool_t, float64_t const *, svint64_t);
17319__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_s64offset_s64)))
17320svint64_t svldnt1_gather_s64offset_s64(svbool_t, int64_t const *, svint64_t);
17321__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64offset_u64)))
17322svuint64_t svldnt1_gather_u64offset_u64(svbool_t, uint64_t const *, svuint64_t);
17323__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64offset_f64)))
17324svfloat64_t svldnt1_gather_u64offset_f64(svbool_t, float64_t const *, svuint64_t);
17325__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64offset_s64)))
17326svint64_t svldnt1_gather_u64offset_s64(svbool_t, int64_t const *, svuint64_t);
17327__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u32base_offset_u32)))
17328svuint32_t svldnt1sb_gather_u32base_offset_u32(svbool_t, svuint32_t, int64_t);
17329__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u64base_offset_u64)))
17330svuint64_t svldnt1sb_gather_u64base_offset_u64(svbool_t, svuint64_t, int64_t);
17331__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u32base_offset_s32)))
17332svint32_t svldnt1sb_gather_u32base_offset_s32(svbool_t, svuint32_t, int64_t);
17333__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u64base_offset_s64)))
17334svint64_t svldnt1sb_gather_u64base_offset_s64(svbool_t, svuint64_t, int64_t);
17335__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u32base_u32)))
17336svuint32_t svldnt1sb_gather_u32base_u32(svbool_t, svuint32_t);
17337__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u64base_u64)))
17338svuint64_t svldnt1sb_gather_u64base_u64(svbool_t, svuint64_t);
17339__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u32base_s32)))
17340svint32_t svldnt1sb_gather_u32base_s32(svbool_t, svuint32_t);
17341__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u64base_s64)))
17342svint64_t svldnt1sb_gather_u64base_s64(svbool_t, svuint64_t);
17343__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u32offset_u32)))
17344svuint32_t svldnt1sb_gather_u32offset_u32(svbool_t, int8_t const *, svuint32_t);
17345__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u32offset_s32)))
17346svint32_t svldnt1sb_gather_u32offset_s32(svbool_t, int8_t const *, svuint32_t);
17347__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_s64offset_u64)))
17348svuint64_t svldnt1sb_gather_s64offset_u64(svbool_t, int8_t const *, svint64_t);
17349__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_s64offset_s64)))
17350svint64_t svldnt1sb_gather_s64offset_s64(svbool_t, int8_t const *, svint64_t);
17351__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u64offset_u64)))
17352svuint64_t svldnt1sb_gather_u64offset_u64(svbool_t, int8_t const *, svuint64_t);
17353__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u64offset_s64)))
17354svint64_t svldnt1sb_gather_u64offset_s64(svbool_t, int8_t const *, svuint64_t);
17355__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32base_index_u32)))
17356svuint32_t svldnt1sh_gather_u32base_index_u32(svbool_t, svuint32_t, int64_t);
17357__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64base_index_u64)))
17358svuint64_t svldnt1sh_gather_u64base_index_u64(svbool_t, svuint64_t, int64_t);
17359__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32base_index_s32)))
17360svint32_t svldnt1sh_gather_u32base_index_s32(svbool_t, svuint32_t, int64_t);
17361__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64base_index_s64)))
17362svint64_t svldnt1sh_gather_u64base_index_s64(svbool_t, svuint64_t, int64_t);
17363__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32base_offset_u32)))
17364svuint32_t svldnt1sh_gather_u32base_offset_u32(svbool_t, svuint32_t, int64_t);
17365__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64base_offset_u64)))
17366svuint64_t svldnt1sh_gather_u64base_offset_u64(svbool_t, svuint64_t, int64_t);
17367__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32base_offset_s32)))
17368svint32_t svldnt1sh_gather_u32base_offset_s32(svbool_t, svuint32_t, int64_t);
17369__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64base_offset_s64)))
17370svint64_t svldnt1sh_gather_u64base_offset_s64(svbool_t, svuint64_t, int64_t);
17371__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32base_u32)))
17372svuint32_t svldnt1sh_gather_u32base_u32(svbool_t, svuint32_t);
17373__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64base_u64)))
17374svuint64_t svldnt1sh_gather_u64base_u64(svbool_t, svuint64_t);
17375__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32base_s32)))
17376svint32_t svldnt1sh_gather_u32base_s32(svbool_t, svuint32_t);
17377__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64base_s64)))
17378svint64_t svldnt1sh_gather_u64base_s64(svbool_t, svuint64_t);
17379__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_s64index_u64)))
17380svuint64_t svldnt1sh_gather_s64index_u64(svbool_t, int16_t const *, svint64_t);
17381__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_s64index_s64)))
17382svint64_t svldnt1sh_gather_s64index_s64(svbool_t, int16_t const *, svint64_t);
17383__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64index_u64)))
17384svuint64_t svldnt1sh_gather_u64index_u64(svbool_t, int16_t const *, svuint64_t);
17385__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64index_s64)))
17386svint64_t svldnt1sh_gather_u64index_s64(svbool_t, int16_t const *, svuint64_t);
17387__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32offset_u32)))
17388svuint32_t svldnt1sh_gather_u32offset_u32(svbool_t, int16_t const *, svuint32_t);
17389__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32offset_s32)))
17390svint32_t svldnt1sh_gather_u32offset_s32(svbool_t, int16_t const *, svuint32_t);
17391__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_s64offset_u64)))
17392svuint64_t svldnt1sh_gather_s64offset_u64(svbool_t, int16_t const *, svint64_t);
17393__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_s64offset_s64)))
17394svint64_t svldnt1sh_gather_s64offset_s64(svbool_t, int16_t const *, svint64_t);
17395__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64offset_u64)))
17396svuint64_t svldnt1sh_gather_u64offset_u64(svbool_t, int16_t const *, svuint64_t);
17397__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64offset_s64)))
17398svint64_t svldnt1sh_gather_u64offset_s64(svbool_t, int16_t const *, svuint64_t);
17399__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64base_index_u64)))
17400svuint64_t svldnt1sw_gather_u64base_index_u64(svbool_t, svuint64_t, int64_t);
17401__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64base_index_s64)))
17402svint64_t svldnt1sw_gather_u64base_index_s64(svbool_t, svuint64_t, int64_t);
17403__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64base_offset_u64)))
17404svuint64_t svldnt1sw_gather_u64base_offset_u64(svbool_t, svuint64_t, int64_t);
17405__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64base_offset_s64)))
17406svint64_t svldnt1sw_gather_u64base_offset_s64(svbool_t, svuint64_t, int64_t);
17407__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64base_u64)))
17408svuint64_t svldnt1sw_gather_u64base_u64(svbool_t, svuint64_t);
17409__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64base_s64)))
17410svint64_t svldnt1sw_gather_u64base_s64(svbool_t, svuint64_t);
17411__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_s64index_u64)))
17412svuint64_t svldnt1sw_gather_s64index_u64(svbool_t, int32_t const *, svint64_t);
17413__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_s64index_s64)))
17414svint64_t svldnt1sw_gather_s64index_s64(svbool_t, int32_t const *, svint64_t);
17415__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64index_u64)))
17416svuint64_t svldnt1sw_gather_u64index_u64(svbool_t, int32_t const *, svuint64_t);
17417__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64index_s64)))
17418svint64_t svldnt1sw_gather_u64index_s64(svbool_t, int32_t const *, svuint64_t);
17419__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_s64offset_u64)))
17420svuint64_t svldnt1sw_gather_s64offset_u64(svbool_t, int32_t const *, svint64_t);
17421__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_s64offset_s64)))
17422svint64_t svldnt1sw_gather_s64offset_s64(svbool_t, int32_t const *, svint64_t);
17423__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64offset_u64)))
17424svuint64_t svldnt1sw_gather_u64offset_u64(svbool_t, int32_t const *, svuint64_t);
17425__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64offset_s64)))
17426svint64_t svldnt1sw_gather_u64offset_s64(svbool_t, int32_t const *, svuint64_t);
17427__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u32base_offset_u32)))
17428svuint32_t svldnt1ub_gather_u32base_offset_u32(svbool_t, svuint32_t, int64_t);
17429__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u64base_offset_u64)))
17430svuint64_t svldnt1ub_gather_u64base_offset_u64(svbool_t, svuint64_t, int64_t);
17431__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u32base_offset_s32)))
17432svint32_t svldnt1ub_gather_u32base_offset_s32(svbool_t, svuint32_t, int64_t);
17433__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u64base_offset_s64)))
17434svint64_t svldnt1ub_gather_u64base_offset_s64(svbool_t, svuint64_t, int64_t);
17435__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u32base_u32)))
17436svuint32_t svldnt1ub_gather_u32base_u32(svbool_t, svuint32_t);
17437__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u64base_u64)))
17438svuint64_t svldnt1ub_gather_u64base_u64(svbool_t, svuint64_t);
17439__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u32base_s32)))
17440svint32_t svldnt1ub_gather_u32base_s32(svbool_t, svuint32_t);
17441__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u64base_s64)))
17442svint64_t svldnt1ub_gather_u64base_s64(svbool_t, svuint64_t);
17443__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u32offset_u32)))
17444svuint32_t svldnt1ub_gather_u32offset_u32(svbool_t, uint8_t const *, svuint32_t);
17445__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u32offset_s32)))
17446svint32_t svldnt1ub_gather_u32offset_s32(svbool_t, uint8_t const *, svuint32_t);
17447__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_s64offset_u64)))
17448svuint64_t svldnt1ub_gather_s64offset_u64(svbool_t, uint8_t const *, svint64_t);
17449__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_s64offset_s64)))
17450svint64_t svldnt1ub_gather_s64offset_s64(svbool_t, uint8_t const *, svint64_t);
17451__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u64offset_u64)))
17452svuint64_t svldnt1ub_gather_u64offset_u64(svbool_t, uint8_t const *, svuint64_t);
17453__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u64offset_s64)))
17454svint64_t svldnt1ub_gather_u64offset_s64(svbool_t, uint8_t const *, svuint64_t);
17455__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32base_index_u32)))
17456svuint32_t svldnt1uh_gather_u32base_index_u32(svbool_t, svuint32_t, int64_t);
17457__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64base_index_u64)))
17458svuint64_t svldnt1uh_gather_u64base_index_u64(svbool_t, svuint64_t, int64_t);
17459__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32base_index_s32)))
17460svint32_t svldnt1uh_gather_u32base_index_s32(svbool_t, svuint32_t, int64_t);
17461__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64base_index_s64)))
17462svint64_t svldnt1uh_gather_u64base_index_s64(svbool_t, svuint64_t, int64_t);
17463__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32base_offset_u32)))
17464svuint32_t svldnt1uh_gather_u32base_offset_u32(svbool_t, svuint32_t, int64_t);
17465__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64base_offset_u64)))
17466svuint64_t svldnt1uh_gather_u64base_offset_u64(svbool_t, svuint64_t, int64_t);
17467__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32base_offset_s32)))
17468svint32_t svldnt1uh_gather_u32base_offset_s32(svbool_t, svuint32_t, int64_t);
17469__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64base_offset_s64)))
17470svint64_t svldnt1uh_gather_u64base_offset_s64(svbool_t, svuint64_t, int64_t);
17471__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32base_u32)))
17472svuint32_t svldnt1uh_gather_u32base_u32(svbool_t, svuint32_t);
17473__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64base_u64)))
17474svuint64_t svldnt1uh_gather_u64base_u64(svbool_t, svuint64_t);
17475__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32base_s32)))
17476svint32_t svldnt1uh_gather_u32base_s32(svbool_t, svuint32_t);
17477__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64base_s64)))
17478svint64_t svldnt1uh_gather_u64base_s64(svbool_t, svuint64_t);
17479__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_s64index_u64)))
17480svuint64_t svldnt1uh_gather_s64index_u64(svbool_t, uint16_t const *, svint64_t);
17481__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_s64index_s64)))
17482svint64_t svldnt1uh_gather_s64index_s64(svbool_t, uint16_t const *, svint64_t);
17483__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64index_u64)))
17484svuint64_t svldnt1uh_gather_u64index_u64(svbool_t, uint16_t const *, svuint64_t);
17485__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64index_s64)))
17486svint64_t svldnt1uh_gather_u64index_s64(svbool_t, uint16_t const *, svuint64_t);
17487__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32offset_u32)))
17488svuint32_t svldnt1uh_gather_u32offset_u32(svbool_t, uint16_t const *, svuint32_t);
17489__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32offset_s32)))
17490svint32_t svldnt1uh_gather_u32offset_s32(svbool_t, uint16_t const *, svuint32_t);
17491__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_s64offset_u64)))
17492svuint64_t svldnt1uh_gather_s64offset_u64(svbool_t, uint16_t const *, svint64_t);
17493__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_s64offset_s64)))
17494svint64_t svldnt1uh_gather_s64offset_s64(svbool_t, uint16_t const *, svint64_t);
17495__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64offset_u64)))
17496svuint64_t svldnt1uh_gather_u64offset_u64(svbool_t, uint16_t const *, svuint64_t);
17497__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64offset_s64)))
17498svint64_t svldnt1uh_gather_u64offset_s64(svbool_t, uint16_t const *, svuint64_t);
17499__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64base_index_u64)))
17500svuint64_t svldnt1uw_gather_u64base_index_u64(svbool_t, svuint64_t, int64_t);
17501__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64base_index_s64)))
17502svint64_t svldnt1uw_gather_u64base_index_s64(svbool_t, svuint64_t, int64_t);
17503__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64base_offset_u64)))
17504svuint64_t svldnt1uw_gather_u64base_offset_u64(svbool_t, svuint64_t, int64_t);
17505__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64base_offset_s64)))
17506svint64_t svldnt1uw_gather_u64base_offset_s64(svbool_t, svuint64_t, int64_t);
17507__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64base_u64)))
17508svuint64_t svldnt1uw_gather_u64base_u64(svbool_t, svuint64_t);
17509__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64base_s64)))
17510svint64_t svldnt1uw_gather_u64base_s64(svbool_t, svuint64_t);
17511__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_s64index_u64)))
17512svuint64_t svldnt1uw_gather_s64index_u64(svbool_t, uint32_t const *, svint64_t);
17513__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_s64index_s64)))
17514svint64_t svldnt1uw_gather_s64index_s64(svbool_t, uint32_t const *, svint64_t);
17515__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64index_u64)))
17516svuint64_t svldnt1uw_gather_u64index_u64(svbool_t, uint32_t const *, svuint64_t);
17517__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64index_s64)))
17518svint64_t svldnt1uw_gather_u64index_s64(svbool_t, uint32_t const *, svuint64_t);
17519__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_s64offset_u64)))
17520svuint64_t svldnt1uw_gather_s64offset_u64(svbool_t, uint32_t const *, svint64_t);
17521__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_s64offset_s64)))
17522svint64_t svldnt1uw_gather_s64offset_s64(svbool_t, uint32_t const *, svint64_t);
17523__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64offset_u64)))
17524svuint64_t svldnt1uw_gather_u64offset_u64(svbool_t, uint32_t const *, svuint64_t);
17525__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64offset_s64)))
17526svint64_t svldnt1uw_gather_u64offset_s64(svbool_t, uint32_t const *, svuint64_t);
17527__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f64_m)))
17528svint64_t svlogb_f64_m(svint64_t, svbool_t, svfloat64_t);
17529__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f32_m)))
17530svint32_t svlogb_f32_m(svint32_t, svbool_t, svfloat32_t);
17531__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f16_m)))
17532svint16_t svlogb_f16_m(svint16_t, svbool_t, svfloat16_t);
17533__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f64_x)))
17534svint64_t svlogb_f64_x(svbool_t, svfloat64_t);
17535__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f32_x)))
17536svint32_t svlogb_f32_x(svbool_t, svfloat32_t);
17537__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f16_x)))
17538svint16_t svlogb_f16_x(svbool_t, svfloat16_t);
17539__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f64_z)))
17540svint64_t svlogb_f64_z(svbool_t, svfloat64_t);
17541__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f32_z)))
17542svint32_t svlogb_f32_z(svbool_t, svfloat32_t);
17543__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f16_z)))
17544svint16_t svlogb_f16_z(svbool_t, svfloat16_t);
17545__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmatch_u8)))
17546svbool_t svmatch_u8(svbool_t, svuint8_t, svuint8_t);
17547__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmatch_u16)))
17548svbool_t svmatch_u16(svbool_t, svuint16_t, svuint16_t);
17549__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmatch_s8)))
17550svbool_t svmatch_s8(svbool_t, svint8_t, svint8_t);
17551__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmatch_s16)))
17552svbool_t svmatch_s16(svbool_t, svint16_t, svint16_t);
17553__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxnmp_f64_m)))
17554svfloat64_t svmaxnmp_f64_m(svbool_t, svfloat64_t, svfloat64_t);
17555__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxnmp_f32_m)))
17556svfloat32_t svmaxnmp_f32_m(svbool_t, svfloat32_t, svfloat32_t);
17557__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxnmp_f16_m)))
17558svfloat16_t svmaxnmp_f16_m(svbool_t, svfloat16_t, svfloat16_t);
17559__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxnmp_f64_x)))
17560svfloat64_t svmaxnmp_f64_x(svbool_t, svfloat64_t, svfloat64_t);
17561__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxnmp_f32_x)))
17562svfloat32_t svmaxnmp_f32_x(svbool_t, svfloat32_t, svfloat32_t);
17563__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxnmp_f16_x)))
17564svfloat16_t svmaxnmp_f16_x(svbool_t, svfloat16_t, svfloat16_t);
17565__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_f64_m)))
17566svfloat64_t svmaxp_f64_m(svbool_t, svfloat64_t, svfloat64_t);
17567__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_f32_m)))
17568svfloat32_t svmaxp_f32_m(svbool_t, svfloat32_t, svfloat32_t);
17569__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_f16_m)))
17570svfloat16_t svmaxp_f16_m(svbool_t, svfloat16_t, svfloat16_t);
17571__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_f64_x)))
17572svfloat64_t svmaxp_f64_x(svbool_t, svfloat64_t, svfloat64_t);
17573__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_f32_x)))
17574svfloat32_t svmaxp_f32_x(svbool_t, svfloat32_t, svfloat32_t);
17575__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_f16_x)))
17576svfloat16_t svmaxp_f16_x(svbool_t, svfloat16_t, svfloat16_t);
17577__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s8_m)))
17578svint8_t svmaxp_s8_m(svbool_t, svint8_t, svint8_t);
17579__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s32_m)))
17580svint32_t svmaxp_s32_m(svbool_t, svint32_t, svint32_t);
17581__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s64_m)))
17582svint64_t svmaxp_s64_m(svbool_t, svint64_t, svint64_t);
17583__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s16_m)))
17584svint16_t svmaxp_s16_m(svbool_t, svint16_t, svint16_t);
17585__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s8_x)))
17586svint8_t svmaxp_s8_x(svbool_t, svint8_t, svint8_t);
17587__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s32_x)))
17588svint32_t svmaxp_s32_x(svbool_t, svint32_t, svint32_t);
17589__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s64_x)))
17590svint64_t svmaxp_s64_x(svbool_t, svint64_t, svint64_t);
17591__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s16_x)))
17592svint16_t svmaxp_s16_x(svbool_t, svint16_t, svint16_t);
17593__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u8_m)))
17594svuint8_t svmaxp_u8_m(svbool_t, svuint8_t, svuint8_t);
17595__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u32_m)))
17596svuint32_t svmaxp_u32_m(svbool_t, svuint32_t, svuint32_t);
17597__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u64_m)))
17598svuint64_t svmaxp_u64_m(svbool_t, svuint64_t, svuint64_t);
17599__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u16_m)))
17600svuint16_t svmaxp_u16_m(svbool_t, svuint16_t, svuint16_t);
17601__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u8_x)))
17602svuint8_t svmaxp_u8_x(svbool_t, svuint8_t, svuint8_t);
17603__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u32_x)))
17604svuint32_t svmaxp_u32_x(svbool_t, svuint32_t, svuint32_t);
17605__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u64_x)))
17606svuint64_t svmaxp_u64_x(svbool_t, svuint64_t, svuint64_t);
17607__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u16_x)))
17608svuint16_t svmaxp_u16_x(svbool_t, svuint16_t, svuint16_t);
17609__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminnmp_f64_m)))
17610svfloat64_t svminnmp_f64_m(svbool_t, svfloat64_t, svfloat64_t);
17611__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminnmp_f32_m)))
17612svfloat32_t svminnmp_f32_m(svbool_t, svfloat32_t, svfloat32_t);
17613__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminnmp_f16_m)))
17614svfloat16_t svminnmp_f16_m(svbool_t, svfloat16_t, svfloat16_t);
17615__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminnmp_f64_x)))
17616svfloat64_t svminnmp_f64_x(svbool_t, svfloat64_t, svfloat64_t);
17617__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminnmp_f32_x)))
17618svfloat32_t svminnmp_f32_x(svbool_t, svfloat32_t, svfloat32_t);
17619__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminnmp_f16_x)))
17620svfloat16_t svminnmp_f16_x(svbool_t, svfloat16_t, svfloat16_t);
17621__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_f64_m)))
17622svfloat64_t svminp_f64_m(svbool_t, svfloat64_t, svfloat64_t);
17623__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_f32_m)))
17624svfloat32_t svminp_f32_m(svbool_t, svfloat32_t, svfloat32_t);
17625__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_f16_m)))
17626svfloat16_t svminp_f16_m(svbool_t, svfloat16_t, svfloat16_t);
17627__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_f64_x)))
17628svfloat64_t svminp_f64_x(svbool_t, svfloat64_t, svfloat64_t);
17629__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_f32_x)))
17630svfloat32_t svminp_f32_x(svbool_t, svfloat32_t, svfloat32_t);
17631__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_f16_x)))
17632svfloat16_t svminp_f16_x(svbool_t, svfloat16_t, svfloat16_t);
17633__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s8_m)))
17634svint8_t svminp_s8_m(svbool_t, svint8_t, svint8_t);
17635__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s32_m)))
17636svint32_t svminp_s32_m(svbool_t, svint32_t, svint32_t);
17637__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s64_m)))
17638svint64_t svminp_s64_m(svbool_t, svint64_t, svint64_t);
17639__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s16_m)))
17640svint16_t svminp_s16_m(svbool_t, svint16_t, svint16_t);
17641__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s8_x)))
17642svint8_t svminp_s8_x(svbool_t, svint8_t, svint8_t);
17643__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s32_x)))
17644svint32_t svminp_s32_x(svbool_t, svint32_t, svint32_t);
17645__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s64_x)))
17646svint64_t svminp_s64_x(svbool_t, svint64_t, svint64_t);
17647__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s16_x)))
17648svint16_t svminp_s16_x(svbool_t, svint16_t, svint16_t);
17649__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u8_m)))
17650svuint8_t svminp_u8_m(svbool_t, svuint8_t, svuint8_t);
17651__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u32_m)))
17652svuint32_t svminp_u32_m(svbool_t, svuint32_t, svuint32_t);
17653__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u64_m)))
17654svuint64_t svminp_u64_m(svbool_t, svuint64_t, svuint64_t);
17655__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u16_m)))
17656svuint16_t svminp_u16_m(svbool_t, svuint16_t, svuint16_t);
17657__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u8_x)))
17658svuint8_t svminp_u8_x(svbool_t, svuint8_t, svuint8_t);
17659__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u32_x)))
17660svuint32_t svminp_u32_x(svbool_t, svuint32_t, svuint32_t);
17661__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u64_x)))
17662svuint64_t svminp_u64_x(svbool_t, svuint64_t, svuint64_t);
17663__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u16_x)))
17664svuint16_t svminp_u16_x(svbool_t, svuint16_t, svuint16_t);
17665__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmla_lane_u32)))
17666svuint32_t svmla_lane_u32(svuint32_t, svuint32_t, svuint32_t, uint64_t);
17667__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmla_lane_u64)))
17668svuint64_t svmla_lane_u64(svuint64_t, svuint64_t, svuint64_t, uint64_t);
17669__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmla_lane_u16)))
17670svuint16_t svmla_lane_u16(svuint16_t, svuint16_t, svuint16_t, uint64_t);
17671__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmla_lane_s32)))
17672svint32_t svmla_lane_s32(svint32_t, svint32_t, svint32_t, uint64_t);
17673__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmla_lane_s64)))
17674svint64_t svmla_lane_s64(svint64_t, svint64_t, svint64_t, uint64_t);
17675__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmla_lane_s16)))
17676svint16_t svmla_lane_s16(svint16_t, svint16_t, svint16_t, uint64_t);
17677__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_n_f32)))
17678svfloat32_t svmlalb_n_f32(svfloat32_t, svfloat16_t, float16_t);
17679__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_n_s32)))
17680svint32_t svmlalb_n_s32(svint32_t, svint16_t, int16_t);
17681__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_n_s64)))
17682svint64_t svmlalb_n_s64(svint64_t, svint32_t, int32_t);
17683__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_n_s16)))
17684svint16_t svmlalb_n_s16(svint16_t, svint8_t, int8_t);
17685__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_n_u32)))
17686svuint32_t svmlalb_n_u32(svuint32_t, svuint16_t, uint16_t);
17687__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_n_u64)))
17688svuint64_t svmlalb_n_u64(svuint64_t, svuint32_t, uint32_t);
17689__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_n_u16)))
17690svuint16_t svmlalb_n_u16(svuint16_t, svuint8_t, uint8_t);
17691__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_f32)))
17692svfloat32_t svmlalb_f32(svfloat32_t, svfloat16_t, svfloat16_t);
17693__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_s32)))
17694svint32_t svmlalb_s32(svint32_t, svint16_t, svint16_t);
17695__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_s64)))
17696svint64_t svmlalb_s64(svint64_t, svint32_t, svint32_t);
17697__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_s16)))
17698svint16_t svmlalb_s16(svint16_t, svint8_t, svint8_t);
17699__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_u32)))
17700svuint32_t svmlalb_u32(svuint32_t, svuint16_t, svuint16_t);
17701__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_u64)))
17702svuint64_t svmlalb_u64(svuint64_t, svuint32_t, svuint32_t);
17703__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_u16)))
17704svuint16_t svmlalb_u16(svuint16_t, svuint8_t, svuint8_t);
17705__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_lane_f32)))
17706svfloat32_t svmlalb_lane_f32(svfloat32_t, svfloat16_t, svfloat16_t, uint64_t);
17707__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_lane_s32)))
17708svint32_t svmlalb_lane_s32(svint32_t, svint16_t, svint16_t, uint64_t);
17709__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_lane_s64)))
17710svint64_t svmlalb_lane_s64(svint64_t, svint32_t, svint32_t, uint64_t);
17711__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_lane_u32)))
17712svuint32_t svmlalb_lane_u32(svuint32_t, svuint16_t, svuint16_t, uint64_t);
17713__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_lane_u64)))
17714svuint64_t svmlalb_lane_u64(svuint64_t, svuint32_t, svuint32_t, uint64_t);
17715__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_n_f32)))
17716svfloat32_t svmlalt_n_f32(svfloat32_t, svfloat16_t, float16_t);
17717__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_n_s32)))
17718svint32_t svmlalt_n_s32(svint32_t, svint16_t, int16_t);
17719__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_n_s64)))
17720svint64_t svmlalt_n_s64(svint64_t, svint32_t, int32_t);
17721__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_n_s16)))
17722svint16_t svmlalt_n_s16(svint16_t, svint8_t, int8_t);
17723__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_n_u32)))
17724svuint32_t svmlalt_n_u32(svuint32_t, svuint16_t, uint16_t);
17725__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_n_u64)))
17726svuint64_t svmlalt_n_u64(svuint64_t, svuint32_t, uint32_t);
17727__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_n_u16)))
17728svuint16_t svmlalt_n_u16(svuint16_t, svuint8_t, uint8_t);
17729__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_f32)))
17730svfloat32_t svmlalt_f32(svfloat32_t, svfloat16_t, svfloat16_t);
17731__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_s32)))
17732svint32_t svmlalt_s32(svint32_t, svint16_t, svint16_t);
17733__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_s64)))
17734svint64_t svmlalt_s64(svint64_t, svint32_t, svint32_t);
17735__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_s16)))
17736svint16_t svmlalt_s16(svint16_t, svint8_t, svint8_t);
17737__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_u32)))
17738svuint32_t svmlalt_u32(svuint32_t, svuint16_t, svuint16_t);
17739__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_u64)))
17740svuint64_t svmlalt_u64(svuint64_t, svuint32_t, svuint32_t);
17741__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_u16)))
17742svuint16_t svmlalt_u16(svuint16_t, svuint8_t, svuint8_t);
17743__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_lane_f32)))
17744svfloat32_t svmlalt_lane_f32(svfloat32_t, svfloat16_t, svfloat16_t, uint64_t);
17745__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_lane_s32)))
17746svint32_t svmlalt_lane_s32(svint32_t, svint16_t, svint16_t, uint64_t);
17747__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_lane_s64)))
17748svint64_t svmlalt_lane_s64(svint64_t, svint32_t, svint32_t, uint64_t);
17749__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_lane_u32)))
17750svuint32_t svmlalt_lane_u32(svuint32_t, svuint16_t, svuint16_t, uint64_t);
17751__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_lane_u64)))
17752svuint64_t svmlalt_lane_u64(svuint64_t, svuint32_t, svuint32_t, uint64_t);
17753__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmls_lane_u32)))
17754svuint32_t svmls_lane_u32(svuint32_t, svuint32_t, svuint32_t, uint64_t);
17755__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmls_lane_u64)))
17756svuint64_t svmls_lane_u64(svuint64_t, svuint64_t, svuint64_t, uint64_t);
17757__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmls_lane_u16)))
17758svuint16_t svmls_lane_u16(svuint16_t, svuint16_t, svuint16_t, uint64_t);
17759__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmls_lane_s32)))
17760svint32_t svmls_lane_s32(svint32_t, svint32_t, svint32_t, uint64_t);
17761__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmls_lane_s64)))
17762svint64_t svmls_lane_s64(svint64_t, svint64_t, svint64_t, uint64_t);
17763__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmls_lane_s16)))
17764svint16_t svmls_lane_s16(svint16_t, svint16_t, svint16_t, uint64_t);
17765__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_n_f32)))
17766svfloat32_t svmlslb_n_f32(svfloat32_t, svfloat16_t, float16_t);
17767__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_n_s32)))
17768svint32_t svmlslb_n_s32(svint32_t, svint16_t, int16_t);
17769__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_n_s64)))
17770svint64_t svmlslb_n_s64(svint64_t, svint32_t, int32_t);
17771__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_n_s16)))
17772svint16_t svmlslb_n_s16(svint16_t, svint8_t, int8_t);
17773__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_n_u32)))
17774svuint32_t svmlslb_n_u32(svuint32_t, svuint16_t, uint16_t);
17775__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_n_u64)))
17776svuint64_t svmlslb_n_u64(svuint64_t, svuint32_t, uint32_t);
17777__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_n_u16)))
17778svuint16_t svmlslb_n_u16(svuint16_t, svuint8_t, uint8_t);
17779__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_f32)))
17780svfloat32_t svmlslb_f32(svfloat32_t, svfloat16_t, svfloat16_t);
17781__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_s32)))
17782svint32_t svmlslb_s32(svint32_t, svint16_t, svint16_t);
17783__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_s64)))
17784svint64_t svmlslb_s64(svint64_t, svint32_t, svint32_t);
17785__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_s16)))
17786svint16_t svmlslb_s16(svint16_t, svint8_t, svint8_t);
17787__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_u32)))
17788svuint32_t svmlslb_u32(svuint32_t, svuint16_t, svuint16_t);
17789__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_u64)))
17790svuint64_t svmlslb_u64(svuint64_t, svuint32_t, svuint32_t);
17791__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_u16)))
17792svuint16_t svmlslb_u16(svuint16_t, svuint8_t, svuint8_t);
17793__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_lane_f32)))
17794svfloat32_t svmlslb_lane_f32(svfloat32_t, svfloat16_t, svfloat16_t, uint64_t);
17795__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_lane_s32)))
17796svint32_t svmlslb_lane_s32(svint32_t, svint16_t, svint16_t, uint64_t);
17797__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_lane_s64)))
17798svint64_t svmlslb_lane_s64(svint64_t, svint32_t, svint32_t, uint64_t);
17799__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_lane_u32)))
17800svuint32_t svmlslb_lane_u32(svuint32_t, svuint16_t, svuint16_t, uint64_t);
17801__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_lane_u64)))
17802svuint64_t svmlslb_lane_u64(svuint64_t, svuint32_t, svuint32_t, uint64_t);
17803__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_n_f32)))
17804svfloat32_t svmlslt_n_f32(svfloat32_t, svfloat16_t, float16_t);
17805__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_n_s32)))
17806svint32_t svmlslt_n_s32(svint32_t, svint16_t, int16_t);
17807__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_n_s64)))
17808svint64_t svmlslt_n_s64(svint64_t, svint32_t, int32_t);
17809__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_n_s16)))
17810svint16_t svmlslt_n_s16(svint16_t, svint8_t, int8_t);
17811__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_n_u32)))
17812svuint32_t svmlslt_n_u32(svuint32_t, svuint16_t, uint16_t);
17813__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_n_u64)))
17814svuint64_t svmlslt_n_u64(svuint64_t, svuint32_t, uint32_t);
17815__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_n_u16)))
17816svuint16_t svmlslt_n_u16(svuint16_t, svuint8_t, uint8_t);
17817__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_f32)))
17818svfloat32_t svmlslt_f32(svfloat32_t, svfloat16_t, svfloat16_t);
17819__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_s32)))
17820svint32_t svmlslt_s32(svint32_t, svint16_t, svint16_t);
17821__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_s64)))
17822svint64_t svmlslt_s64(svint64_t, svint32_t, svint32_t);
17823__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_s16)))
17824svint16_t svmlslt_s16(svint16_t, svint8_t, svint8_t);
17825__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_u32)))
17826svuint32_t svmlslt_u32(svuint32_t, svuint16_t, svuint16_t);
17827__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_u64)))
17828svuint64_t svmlslt_u64(svuint64_t, svuint32_t, svuint32_t);
17829__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_u16)))
17830svuint16_t svmlslt_u16(svuint16_t, svuint8_t, svuint8_t);
17831__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_lane_f32)))
17832svfloat32_t svmlslt_lane_f32(svfloat32_t, svfloat16_t, svfloat16_t, uint64_t);
17833__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_lane_s32)))
17834svint32_t svmlslt_lane_s32(svint32_t, svint16_t, svint16_t, uint64_t);
17835__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_lane_s64)))
17836svint64_t svmlslt_lane_s64(svint64_t, svint32_t, svint32_t, uint64_t);
17837__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_lane_u32)))
17838svuint32_t svmlslt_lane_u32(svuint32_t, svuint16_t, svuint16_t, uint64_t);
17839__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_lane_u64)))
17840svuint64_t svmlslt_lane_u64(svuint64_t, svuint32_t, svuint32_t, uint64_t);
17841__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlb_s32)))
17842svint32_t svmovlb_s32(svint16_t);
17843__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlb_s64)))
17844svint64_t svmovlb_s64(svint32_t);
17845__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlb_s16)))
17846svint16_t svmovlb_s16(svint8_t);
17847__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlb_u32)))
17848svuint32_t svmovlb_u32(svuint16_t);
17849__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlb_u64)))
17850svuint64_t svmovlb_u64(svuint32_t);
17851__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlb_u16)))
17852svuint16_t svmovlb_u16(svuint8_t);
17853__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlt_s32)))
17854svint32_t svmovlt_s32(svint16_t);
17855__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlt_s64)))
17856svint64_t svmovlt_s64(svint32_t);
17857__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlt_s16)))
17858svint16_t svmovlt_s16(svint8_t);
17859__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlt_u32)))
17860svuint32_t svmovlt_u32(svuint16_t);
17861__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlt_u64)))
17862svuint64_t svmovlt_u64(svuint32_t);
17863__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlt_u16)))
17864svuint16_t svmovlt_u16(svuint8_t);
17865__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmul_lane_u32)))
17866svuint32_t svmul_lane_u32(svuint32_t, svuint32_t, uint64_t);
17867__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmul_lane_u64)))
17868svuint64_t svmul_lane_u64(svuint64_t, svuint64_t, uint64_t);
17869__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmul_lane_u16)))
17870svuint16_t svmul_lane_u16(svuint16_t, svuint16_t, uint64_t);
17871__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmul_lane_s32)))
17872svint32_t svmul_lane_s32(svint32_t, svint32_t, uint64_t);
17873__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmul_lane_s64)))
17874svint64_t svmul_lane_s64(svint64_t, svint64_t, uint64_t);
17875__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmul_lane_s16)))
17876svint16_t svmul_lane_s16(svint16_t, svint16_t, uint64_t);
17877__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_n_s32)))
17878svint32_t svmullb_n_s32(svint16_t, int16_t);
17879__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_n_s64)))
17880svint64_t svmullb_n_s64(svint32_t, int32_t);
17881__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_n_s16)))
17882svint16_t svmullb_n_s16(svint8_t, int8_t);
17883__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_n_u32)))
17884svuint32_t svmullb_n_u32(svuint16_t, uint16_t);
17885__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_n_u64)))
17886svuint64_t svmullb_n_u64(svuint32_t, uint32_t);
17887__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_n_u16)))
17888svuint16_t svmullb_n_u16(svuint8_t, uint8_t);
17889__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_s32)))
17890svint32_t svmullb_s32(svint16_t, svint16_t);
17891__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_s64)))
17892svint64_t svmullb_s64(svint32_t, svint32_t);
17893__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_s16)))
17894svint16_t svmullb_s16(svint8_t, svint8_t);
17895__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_u32)))
17896svuint32_t svmullb_u32(svuint16_t, svuint16_t);
17897__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_u64)))
17898svuint64_t svmullb_u64(svuint32_t, svuint32_t);
17899__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_u16)))
17900svuint16_t svmullb_u16(svuint8_t, svuint8_t);
17901__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_lane_s32)))
17902svint32_t svmullb_lane_s32(svint16_t, svint16_t, uint64_t);
17903__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_lane_s64)))
17904svint64_t svmullb_lane_s64(svint32_t, svint32_t, uint64_t);
17905__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_lane_u32)))
17906svuint32_t svmullb_lane_u32(svuint16_t, svuint16_t, uint64_t);
17907__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_lane_u64)))
17908svuint64_t svmullb_lane_u64(svuint32_t, svuint32_t, uint64_t);
17909__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_n_s32)))
17910svint32_t svmullt_n_s32(svint16_t, int16_t);
17911__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_n_s64)))
17912svint64_t svmullt_n_s64(svint32_t, int32_t);
17913__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_n_s16)))
17914svint16_t svmullt_n_s16(svint8_t, int8_t);
17915__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_n_u32)))
17916svuint32_t svmullt_n_u32(svuint16_t, uint16_t);
17917__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_n_u64)))
17918svuint64_t svmullt_n_u64(svuint32_t, uint32_t);
17919__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_n_u16)))
17920svuint16_t svmullt_n_u16(svuint8_t, uint8_t);
17921__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_s32)))
17922svint32_t svmullt_s32(svint16_t, svint16_t);
17923__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_s64)))
17924svint64_t svmullt_s64(svint32_t, svint32_t);
17925__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_s16)))
17926svint16_t svmullt_s16(svint8_t, svint8_t);
17927__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_u32)))
17928svuint32_t svmullt_u32(svuint16_t, svuint16_t);
17929__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_u64)))
17930svuint64_t svmullt_u64(svuint32_t, svuint32_t);
17931__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_u16)))
17932svuint16_t svmullt_u16(svuint8_t, svuint8_t);
17933__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_lane_s32)))
17934svint32_t svmullt_lane_s32(svint16_t, svint16_t, uint64_t);
17935__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_lane_s64)))
17936svint64_t svmullt_lane_s64(svint32_t, svint32_t, uint64_t);
17937__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_lane_u32)))
17938svuint32_t svmullt_lane_u32(svuint16_t, svuint16_t, uint64_t);
17939__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_lane_u64)))
17940svuint64_t svmullt_lane_u64(svuint32_t, svuint32_t, uint64_t);
17941__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_u8)))
17942svuint8_t svnbsl_n_u8(svuint8_t, svuint8_t, uint8_t);
17943__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_u32)))
17944svuint32_t svnbsl_n_u32(svuint32_t, svuint32_t, uint32_t);
17945__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_u64)))
17946svuint64_t svnbsl_n_u64(svuint64_t, svuint64_t, uint64_t);
17947__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_u16)))
17948svuint16_t svnbsl_n_u16(svuint16_t, svuint16_t, uint16_t);
17949__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_s8)))
17950svint8_t svnbsl_n_s8(svint8_t, svint8_t, int8_t);
17951__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_s32)))
17952svint32_t svnbsl_n_s32(svint32_t, svint32_t, int32_t);
17953__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_s64)))
17954svint64_t svnbsl_n_s64(svint64_t, svint64_t, int64_t);
17955__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_s16)))
17956svint16_t svnbsl_n_s16(svint16_t, svint16_t, int16_t);
17957__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_u8)))
17958svuint8_t svnbsl_u8(svuint8_t, svuint8_t, svuint8_t);
17959__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_u32)))
17960svuint32_t svnbsl_u32(svuint32_t, svuint32_t, svuint32_t);
17961__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_u64)))
17962svuint64_t svnbsl_u64(svuint64_t, svuint64_t, svuint64_t);
17963__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_u16)))
17964svuint16_t svnbsl_u16(svuint16_t, svuint16_t, svuint16_t);
17965__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_s8)))
17966svint8_t svnbsl_s8(svint8_t, svint8_t, svint8_t);
17967__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_s32)))
17968svint32_t svnbsl_s32(svint32_t, svint32_t, svint32_t);
17969__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_s64)))
17970svint64_t svnbsl_s64(svint64_t, svint64_t, svint64_t);
17971__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_s16)))
17972svint16_t svnbsl_s16(svint16_t, svint16_t, svint16_t);
17973__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnmatch_u8)))
17974svbool_t svnmatch_u8(svbool_t, svuint8_t, svuint8_t);
17975__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnmatch_u16)))
17976svbool_t svnmatch_u16(svbool_t, svuint16_t, svuint16_t);
17977__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnmatch_s8)))
17978svbool_t svnmatch_s8(svbool_t, svint8_t, svint8_t);
17979__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnmatch_s16)))
17980svbool_t svnmatch_s16(svbool_t, svint16_t, svint16_t);
17981__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmul_n_u8)))
17982svuint8_t svpmul_n_u8(svuint8_t, uint8_t);
17983__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmul_u8)))
17984svuint8_t svpmul_u8(svuint8_t, svuint8_t);
17985__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_n_u64)))
17986svuint64_t svpmullb_n_u64(svuint32_t, uint32_t);
17987__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_n_u16)))
17988svuint16_t svpmullb_n_u16(svuint8_t, uint8_t);
17989__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_u64)))
17990svuint64_t svpmullb_u64(svuint32_t, svuint32_t);
17991__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_u16)))
17992svuint16_t svpmullb_u16(svuint8_t, svuint8_t);
17993__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_pair_n_u8)))
17994svuint8_t svpmullb_pair_n_u8(svuint8_t, uint8_t);
17995__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_pair_n_u32)))
17996svuint32_t svpmullb_pair_n_u32(svuint32_t, uint32_t);
17997__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_pair_u8)))
17998svuint8_t svpmullb_pair_u8(svuint8_t, svuint8_t);
17999__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_pair_u32)))
18000svuint32_t svpmullb_pair_u32(svuint32_t, svuint32_t);
18001__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_n_u64)))
18002svuint64_t svpmullt_n_u64(svuint32_t, uint32_t);
18003__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_n_u16)))
18004svuint16_t svpmullt_n_u16(svuint8_t, uint8_t);
18005__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_u64)))
18006svuint64_t svpmullt_u64(svuint32_t, svuint32_t);
18007__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_u16)))
18008svuint16_t svpmullt_u16(svuint8_t, svuint8_t);
18009__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_pair_n_u8)))
18010svuint8_t svpmullt_pair_n_u8(svuint8_t, uint8_t);
18011__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_pair_n_u32)))
18012svuint32_t svpmullt_pair_n_u32(svuint32_t, uint32_t);
18013__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_pair_u8)))
18014svuint8_t svpmullt_pair_u8(svuint8_t, svuint8_t);
18015__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_pair_u32)))
18016svuint32_t svpmullt_pair_u32(svuint32_t, svuint32_t);
18017__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s8_m)))
18018svint8_t svqabs_s8_m(svint8_t, svbool_t, svint8_t);
18019__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s32_m)))
18020svint32_t svqabs_s32_m(svint32_t, svbool_t, svint32_t);
18021__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s64_m)))
18022svint64_t svqabs_s64_m(svint64_t, svbool_t, svint64_t);
18023__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s16_m)))
18024svint16_t svqabs_s16_m(svint16_t, svbool_t, svint16_t);
18025__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s8_x)))
18026svint8_t svqabs_s8_x(svbool_t, svint8_t);
18027__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s32_x)))
18028svint32_t svqabs_s32_x(svbool_t, svint32_t);
18029__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s64_x)))
18030svint64_t svqabs_s64_x(svbool_t, svint64_t);
18031__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s16_x)))
18032svint16_t svqabs_s16_x(svbool_t, svint16_t);
18033__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s8_z)))
18034svint8_t svqabs_s8_z(svbool_t, svint8_t);
18035__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s32_z)))
18036svint32_t svqabs_s32_z(svbool_t, svint32_t);
18037__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s64_z)))
18038svint64_t svqabs_s64_z(svbool_t, svint64_t);
18039__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s16_z)))
18040svint16_t svqabs_s16_z(svbool_t, svint16_t);
18041__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s8_m)))
18042svint8_t svqadd_n_s8_m(svbool_t, svint8_t, int8_t);
18043__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s32_m)))
18044svint32_t svqadd_n_s32_m(svbool_t, svint32_t, int32_t);
18045__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s64_m)))
18046svint64_t svqadd_n_s64_m(svbool_t, svint64_t, int64_t);
18047__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s16_m)))
18048svint16_t svqadd_n_s16_m(svbool_t, svint16_t, int16_t);
18049__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s8_x)))
18050svint8_t svqadd_n_s8_x(svbool_t, svint8_t, int8_t);
18051__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s32_x)))
18052svint32_t svqadd_n_s32_x(svbool_t, svint32_t, int32_t);
18053__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s64_x)))
18054svint64_t svqadd_n_s64_x(svbool_t, svint64_t, int64_t);
18055__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s16_x)))
18056svint16_t svqadd_n_s16_x(svbool_t, svint16_t, int16_t);
18057__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s8_z)))
18058svint8_t svqadd_n_s8_z(svbool_t, svint8_t, int8_t);
18059__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s32_z)))
18060svint32_t svqadd_n_s32_z(svbool_t, svint32_t, int32_t);
18061__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s64_z)))
18062svint64_t svqadd_n_s64_z(svbool_t, svint64_t, int64_t);
18063__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s16_z)))
18064svint16_t svqadd_n_s16_z(svbool_t, svint16_t, int16_t);
18065__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u8_m)))
18066svuint8_t svqadd_n_u8_m(svbool_t, svuint8_t, uint8_t);
18067__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u32_m)))
18068svuint32_t svqadd_n_u32_m(svbool_t, svuint32_t, uint32_t);
18069__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u64_m)))
18070svuint64_t svqadd_n_u64_m(svbool_t, svuint64_t, uint64_t);
18071__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u16_m)))
18072svuint16_t svqadd_n_u16_m(svbool_t, svuint16_t, uint16_t);
18073__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u8_x)))
18074svuint8_t svqadd_n_u8_x(svbool_t, svuint8_t, uint8_t);
18075__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u32_x)))
18076svuint32_t svqadd_n_u32_x(svbool_t, svuint32_t, uint32_t);
18077__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u64_x)))
18078svuint64_t svqadd_n_u64_x(svbool_t, svuint64_t, uint64_t);
18079__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u16_x)))
18080svuint16_t svqadd_n_u16_x(svbool_t, svuint16_t, uint16_t);
18081__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u8_z)))
18082svuint8_t svqadd_n_u8_z(svbool_t, svuint8_t, uint8_t);
18083__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u32_z)))
18084svuint32_t svqadd_n_u32_z(svbool_t, svuint32_t, uint32_t);
18085__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u64_z)))
18086svuint64_t svqadd_n_u64_z(svbool_t, svuint64_t, uint64_t);
18087__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u16_z)))
18088svuint16_t svqadd_n_u16_z(svbool_t, svuint16_t, uint16_t);
18089__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s8_m)))
18090svint8_t svqadd_s8_m(svbool_t, svint8_t, svint8_t);
18091__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s32_m)))
18092svint32_t svqadd_s32_m(svbool_t, svint32_t, svint32_t);
18093__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s64_m)))
18094svint64_t svqadd_s64_m(svbool_t, svint64_t, svint64_t);
18095__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s16_m)))
18096svint16_t svqadd_s16_m(svbool_t, svint16_t, svint16_t);
18097__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s8_x)))
18098svint8_t svqadd_s8_x(svbool_t, svint8_t, svint8_t);
18099__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s32_x)))
18100svint32_t svqadd_s32_x(svbool_t, svint32_t, svint32_t);
18101__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s64_x)))
18102svint64_t svqadd_s64_x(svbool_t, svint64_t, svint64_t);
18103__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s16_x)))
18104svint16_t svqadd_s16_x(svbool_t, svint16_t, svint16_t);
18105__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s8_z)))
18106svint8_t svqadd_s8_z(svbool_t, svint8_t, svint8_t);
18107__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s32_z)))
18108svint32_t svqadd_s32_z(svbool_t, svint32_t, svint32_t);
18109__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s64_z)))
18110svint64_t svqadd_s64_z(svbool_t, svint64_t, svint64_t);
18111__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s16_z)))
18112svint16_t svqadd_s16_z(svbool_t, svint16_t, svint16_t);
18113__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u8_m)))
18114svuint8_t svqadd_u8_m(svbool_t, svuint8_t, svuint8_t);
18115__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u32_m)))
18116svuint32_t svqadd_u32_m(svbool_t, svuint32_t, svuint32_t);
18117__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u64_m)))
18118svuint64_t svqadd_u64_m(svbool_t, svuint64_t, svuint64_t);
18119__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u16_m)))
18120svuint16_t svqadd_u16_m(svbool_t, svuint16_t, svuint16_t);
18121__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u8_x)))
18122svuint8_t svqadd_u8_x(svbool_t, svuint8_t, svuint8_t);
18123__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u32_x)))
18124svuint32_t svqadd_u32_x(svbool_t, svuint32_t, svuint32_t);
18125__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u64_x)))
18126svuint64_t svqadd_u64_x(svbool_t, svuint64_t, svuint64_t);
18127__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u16_x)))
18128svuint16_t svqadd_u16_x(svbool_t, svuint16_t, svuint16_t);
18129__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u8_z)))
18130svuint8_t svqadd_u8_z(svbool_t, svuint8_t, svuint8_t);
18131__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u32_z)))
18132svuint32_t svqadd_u32_z(svbool_t, svuint32_t, svuint32_t);
18133__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u64_z)))
18134svuint64_t svqadd_u64_z(svbool_t, svuint64_t, svuint64_t);
18135__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u16_z)))
18136svuint16_t svqadd_u16_z(svbool_t, svuint16_t, svuint16_t);
18137__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqcadd_s8)))
18138svint8_t svqcadd_s8(svint8_t, svint8_t, uint64_t);
18139__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqcadd_s32)))
18140svint32_t svqcadd_s32(svint32_t, svint32_t, uint64_t);
18141__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqcadd_s64)))
18142svint64_t svqcadd_s64(svint64_t, svint64_t, uint64_t);
18143__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqcadd_s16)))
18144svint16_t svqcadd_s16(svint16_t, svint16_t, uint64_t);
18145__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_n_s32)))
18146svint32_t svqdmlalb_n_s32(svint32_t, svint16_t, int16_t);
18147__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_n_s64)))
18148svint64_t svqdmlalb_n_s64(svint64_t, svint32_t, int32_t);
18149__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_n_s16)))
18150svint16_t svqdmlalb_n_s16(svint16_t, svint8_t, int8_t);
18151__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_s32)))
18152svint32_t svqdmlalb_s32(svint32_t, svint16_t, svint16_t);
18153__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_s64)))
18154svint64_t svqdmlalb_s64(svint64_t, svint32_t, svint32_t);
18155__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_s16)))
18156svint16_t svqdmlalb_s16(svint16_t, svint8_t, svint8_t);
18157__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_lane_s32)))
18158svint32_t svqdmlalb_lane_s32(svint32_t, svint16_t, svint16_t, uint64_t);
18159__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_lane_s64)))
18160svint64_t svqdmlalb_lane_s64(svint64_t, svint32_t, svint32_t, uint64_t);
18161__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalbt_n_s32)))
18162svint32_t svqdmlalbt_n_s32(svint32_t, svint16_t, int16_t);
18163__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalbt_n_s64)))
18164svint64_t svqdmlalbt_n_s64(svint64_t, svint32_t, int32_t);
18165__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalbt_n_s16)))
18166svint16_t svqdmlalbt_n_s16(svint16_t, svint8_t, int8_t);
18167__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalbt_s32)))
18168svint32_t svqdmlalbt_s32(svint32_t, svint16_t, svint16_t);
18169__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalbt_s64)))
18170svint64_t svqdmlalbt_s64(svint64_t, svint32_t, svint32_t);
18171__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalbt_s16)))
18172svint16_t svqdmlalbt_s16(svint16_t, svint8_t, svint8_t);
18173__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_n_s32)))
18174svint32_t svqdmlalt_n_s32(svint32_t, svint16_t, int16_t);
18175__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_n_s64)))
18176svint64_t svqdmlalt_n_s64(svint64_t, svint32_t, int32_t);
18177__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_n_s16)))
18178svint16_t svqdmlalt_n_s16(svint16_t, svint8_t, int8_t);
18179__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_s32)))
18180svint32_t svqdmlalt_s32(svint32_t, svint16_t, svint16_t);
18181__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_s64)))
18182svint64_t svqdmlalt_s64(svint64_t, svint32_t, svint32_t);
18183__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_s16)))
18184svint16_t svqdmlalt_s16(svint16_t, svint8_t, svint8_t);
18185__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_lane_s32)))
18186svint32_t svqdmlalt_lane_s32(svint32_t, svint16_t, svint16_t, uint64_t);
18187__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_lane_s64)))
18188svint64_t svqdmlalt_lane_s64(svint64_t, svint32_t, svint32_t, uint64_t);
18189__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_n_s32)))
18190svint32_t svqdmlslb_n_s32(svint32_t, svint16_t, int16_t);
18191__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_n_s64)))
18192svint64_t svqdmlslb_n_s64(svint64_t, svint32_t, int32_t);
18193__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_n_s16)))
18194svint16_t svqdmlslb_n_s16(svint16_t, svint8_t, int8_t);
18195__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_s32)))
18196svint32_t svqdmlslb_s32(svint32_t, svint16_t, svint16_t);
18197__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_s64)))
18198svint64_t svqdmlslb_s64(svint64_t, svint32_t, svint32_t);
18199__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_s16)))
18200svint16_t svqdmlslb_s16(svint16_t, svint8_t, svint8_t);
18201__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_lane_s32)))
18202svint32_t svqdmlslb_lane_s32(svint32_t, svint16_t, svint16_t, uint64_t);
18203__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_lane_s64)))
18204svint64_t svqdmlslb_lane_s64(svint64_t, svint32_t, svint32_t, uint64_t);
18205__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslbt_n_s32)))
18206svint32_t svqdmlslbt_n_s32(svint32_t, svint16_t, int16_t);
18207__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslbt_n_s64)))
18208svint64_t svqdmlslbt_n_s64(svint64_t, svint32_t, int32_t);
18209__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslbt_n_s16)))
18210svint16_t svqdmlslbt_n_s16(svint16_t, svint8_t, int8_t);
18211__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslbt_s32)))
18212svint32_t svqdmlslbt_s32(svint32_t, svint16_t, svint16_t);
18213__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslbt_s64)))
18214svint64_t svqdmlslbt_s64(svint64_t, svint32_t, svint32_t);
18215__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslbt_s16)))
18216svint16_t svqdmlslbt_s16(svint16_t, svint8_t, svint8_t);
18217__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_n_s32)))
18218svint32_t svqdmlslt_n_s32(svint32_t, svint16_t, int16_t);
18219__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_n_s64)))
18220svint64_t svqdmlslt_n_s64(svint64_t, svint32_t, int32_t);
18221__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_n_s16)))
18222svint16_t svqdmlslt_n_s16(svint16_t, svint8_t, int8_t);
18223__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_s32)))
18224svint32_t svqdmlslt_s32(svint32_t, svint16_t, svint16_t);
18225__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_s64)))
18226svint64_t svqdmlslt_s64(svint64_t, svint32_t, svint32_t);
18227__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_s16)))
18228svint16_t svqdmlslt_s16(svint16_t, svint8_t, svint8_t);
18229__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_lane_s32)))
18230svint32_t svqdmlslt_lane_s32(svint32_t, svint16_t, svint16_t, uint64_t);
18231__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_lane_s64)))
18232svint64_t svqdmlslt_lane_s64(svint64_t, svint32_t, svint32_t, uint64_t);
18233__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_n_s8)))
18234svint8_t svqdmulh_n_s8(svint8_t, int8_t);
18235__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_n_s32)))
18236svint32_t svqdmulh_n_s32(svint32_t, int32_t);
18237__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_n_s64)))
18238svint64_t svqdmulh_n_s64(svint64_t, int64_t);
18239__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_n_s16)))
18240svint16_t svqdmulh_n_s16(svint16_t, int16_t);
18241__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_s8)))
18242svint8_t svqdmulh_s8(svint8_t, svint8_t);
18243__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_s32)))
18244svint32_t svqdmulh_s32(svint32_t, svint32_t);
18245__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_s64)))
18246svint64_t svqdmulh_s64(svint64_t, svint64_t);
18247__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_s16)))
18248svint16_t svqdmulh_s16(svint16_t, svint16_t);
18249__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_lane_s32)))
18250svint32_t svqdmulh_lane_s32(svint32_t, svint32_t, uint64_t);
18251__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_lane_s64)))
18252svint64_t svqdmulh_lane_s64(svint64_t, svint64_t, uint64_t);
18253__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_lane_s16)))
18254svint16_t svqdmulh_lane_s16(svint16_t, svint16_t, uint64_t);
18255__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_n_s32)))
18256svint32_t svqdmullb_n_s32(svint16_t, int16_t);
18257__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_n_s64)))
18258svint64_t svqdmullb_n_s64(svint32_t, int32_t);
18259__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_n_s16)))
18260svint16_t svqdmullb_n_s16(svint8_t, int8_t);
18261__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_s32)))
18262svint32_t svqdmullb_s32(svint16_t, svint16_t);
18263__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_s64)))
18264svint64_t svqdmullb_s64(svint32_t, svint32_t);
18265__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_s16)))
18266svint16_t svqdmullb_s16(svint8_t, svint8_t);
18267__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_lane_s32)))
18268svint32_t svqdmullb_lane_s32(svint16_t, svint16_t, uint64_t);
18269__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_lane_s64)))
18270svint64_t svqdmullb_lane_s64(svint32_t, svint32_t, uint64_t);
18271__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_n_s32)))
18272svint32_t svqdmullt_n_s32(svint16_t, int16_t);
18273__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_n_s64)))
18274svint64_t svqdmullt_n_s64(svint32_t, int32_t);
18275__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_n_s16)))
18276svint16_t svqdmullt_n_s16(svint8_t, int8_t);
18277__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_s32)))
18278svint32_t svqdmullt_s32(svint16_t, svint16_t);
18279__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_s64)))
18280svint64_t svqdmullt_s64(svint32_t, svint32_t);
18281__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_s16)))
18282svint16_t svqdmullt_s16(svint8_t, svint8_t);
18283__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_lane_s32)))
18284svint32_t svqdmullt_lane_s32(svint16_t, svint16_t, uint64_t);
18285__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_lane_s64)))
18286svint64_t svqdmullt_lane_s64(svint32_t, svint32_t, uint64_t);
18287__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s8_m)))
18288svint8_t svqneg_s8_m(svint8_t, svbool_t, svint8_t);
18289__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s32_m)))
18290svint32_t svqneg_s32_m(svint32_t, svbool_t, svint32_t);
18291__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s64_m)))
18292svint64_t svqneg_s64_m(svint64_t, svbool_t, svint64_t);
18293__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s16_m)))
18294svint16_t svqneg_s16_m(svint16_t, svbool_t, svint16_t);
18295__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s8_x)))
18296svint8_t svqneg_s8_x(svbool_t, svint8_t);
18297__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s32_x)))
18298svint32_t svqneg_s32_x(svbool_t, svint32_t);
18299__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s64_x)))
18300svint64_t svqneg_s64_x(svbool_t, svint64_t);
18301__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s16_x)))
18302svint16_t svqneg_s16_x(svbool_t, svint16_t);
18303__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s8_z)))
18304svint8_t svqneg_s8_z(svbool_t, svint8_t);
18305__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s32_z)))
18306svint32_t svqneg_s32_z(svbool_t, svint32_t);
18307__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s64_z)))
18308svint64_t svqneg_s64_z(svbool_t, svint64_t);
18309__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s16_z)))
18310svint16_t svqneg_s16_z(svbool_t, svint16_t);
18311__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdcmlah_s8)))
18312svint8_t svqrdcmlah_s8(svint8_t, svint8_t, svint8_t, uint64_t);
18313__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdcmlah_s32)))
18314svint32_t svqrdcmlah_s32(svint32_t, svint32_t, svint32_t, uint64_t);
18315__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdcmlah_s64)))
18316svint64_t svqrdcmlah_s64(svint64_t, svint64_t, svint64_t, uint64_t);
18317__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdcmlah_s16)))
18318svint16_t svqrdcmlah_s16(svint16_t, svint16_t, svint16_t, uint64_t);
18319__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdcmlah_lane_s32)))
18320svint32_t svqrdcmlah_lane_s32(svint32_t, svint32_t, svint32_t, uint64_t, uint64_t);
18321__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdcmlah_lane_s16)))
18322svint16_t svqrdcmlah_lane_s16(svint16_t, svint16_t, svint16_t, uint64_t, uint64_t);
18323__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_n_s8)))
18324svint8_t svqrdmlah_n_s8(svint8_t, svint8_t, int8_t);
18325__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_n_s32)))
18326svint32_t svqrdmlah_n_s32(svint32_t, svint32_t, int32_t);
18327__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_n_s64)))
18328svint64_t svqrdmlah_n_s64(svint64_t, svint64_t, int64_t);
18329__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_n_s16)))
18330svint16_t svqrdmlah_n_s16(svint16_t, svint16_t, int16_t);
18331__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_s8)))
18332svint8_t svqrdmlah_s8(svint8_t, svint8_t, svint8_t);
18333__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_s32)))
18334svint32_t svqrdmlah_s32(svint32_t, svint32_t, svint32_t);
18335__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_s64)))
18336svint64_t svqrdmlah_s64(svint64_t, svint64_t, svint64_t);
18337__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_s16)))
18338svint16_t svqrdmlah_s16(svint16_t, svint16_t, svint16_t);
18339__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_lane_s32)))
18340svint32_t svqrdmlah_lane_s32(svint32_t, svint32_t, svint32_t, uint64_t);
18341__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_lane_s64)))
18342svint64_t svqrdmlah_lane_s64(svint64_t, svint64_t, svint64_t, uint64_t);
18343__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_lane_s16)))
18344svint16_t svqrdmlah_lane_s16(svint16_t, svint16_t, svint16_t, uint64_t);
18345__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_n_s8)))
18346svint8_t svqrdmlsh_n_s8(svint8_t, svint8_t, int8_t);
18347__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_n_s32)))
18348svint32_t svqrdmlsh_n_s32(svint32_t, svint32_t, int32_t);
18349__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_n_s64)))
18350svint64_t svqrdmlsh_n_s64(svint64_t, svint64_t, int64_t);
18351__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_n_s16)))
18352svint16_t svqrdmlsh_n_s16(svint16_t, svint16_t, int16_t);
18353__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_s8)))
18354svint8_t svqrdmlsh_s8(svint8_t, svint8_t, svint8_t);
18355__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_s32)))
18356svint32_t svqrdmlsh_s32(svint32_t, svint32_t, svint32_t);
18357__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_s64)))
18358svint64_t svqrdmlsh_s64(svint64_t, svint64_t, svint64_t);
18359__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_s16)))
18360svint16_t svqrdmlsh_s16(svint16_t, svint16_t, svint16_t);
18361__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_lane_s32)))
18362svint32_t svqrdmlsh_lane_s32(svint32_t, svint32_t, svint32_t, uint64_t);
18363__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_lane_s64)))
18364svint64_t svqrdmlsh_lane_s64(svint64_t, svint64_t, svint64_t, uint64_t);
18365__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_lane_s16)))
18366svint16_t svqrdmlsh_lane_s16(svint16_t, svint16_t, svint16_t, uint64_t);
18367__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_n_s8)))
18368svint8_t svqrdmulh_n_s8(svint8_t, int8_t);
18369__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_n_s32)))
18370svint32_t svqrdmulh_n_s32(svint32_t, int32_t);
18371__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_n_s64)))
18372svint64_t svqrdmulh_n_s64(svint64_t, int64_t);
18373__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_n_s16)))
18374svint16_t svqrdmulh_n_s16(svint16_t, int16_t);
18375__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_s8)))
18376svint8_t svqrdmulh_s8(svint8_t, svint8_t);
18377__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_s32)))
18378svint32_t svqrdmulh_s32(svint32_t, svint32_t);
18379__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_s64)))
18380svint64_t svqrdmulh_s64(svint64_t, svint64_t);
18381__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_s16)))
18382svint16_t svqrdmulh_s16(svint16_t, svint16_t);
18383__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_lane_s32)))
18384svint32_t svqrdmulh_lane_s32(svint32_t, svint32_t, uint64_t);
18385__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_lane_s64)))
18386svint64_t svqrdmulh_lane_s64(svint64_t, svint64_t, uint64_t);
18387__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_lane_s16)))
18388svint16_t svqrdmulh_lane_s16(svint16_t, svint16_t, uint64_t);
18389__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s8_m)))
18390svint8_t svqrshl_n_s8_m(svbool_t, svint8_t, int8_t);
18391__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s32_m)))
18392svint32_t svqrshl_n_s32_m(svbool_t, svint32_t, int32_t);
18393__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s64_m)))
18394svint64_t svqrshl_n_s64_m(svbool_t, svint64_t, int64_t);
18395__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s16_m)))
18396svint16_t svqrshl_n_s16_m(svbool_t, svint16_t, int16_t);
18397__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s8_x)))
18398svint8_t svqrshl_n_s8_x(svbool_t, svint8_t, int8_t);
18399__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s32_x)))
18400svint32_t svqrshl_n_s32_x(svbool_t, svint32_t, int32_t);
18401__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s64_x)))
18402svint64_t svqrshl_n_s64_x(svbool_t, svint64_t, int64_t);
18403__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s16_x)))
18404svint16_t svqrshl_n_s16_x(svbool_t, svint16_t, int16_t);
18405__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s8_z)))
18406svint8_t svqrshl_n_s8_z(svbool_t, svint8_t, int8_t);
18407__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s32_z)))
18408svint32_t svqrshl_n_s32_z(svbool_t, svint32_t, int32_t);
18409__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s64_z)))
18410svint64_t svqrshl_n_s64_z(svbool_t, svint64_t, int64_t);
18411__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s16_z)))
18412svint16_t svqrshl_n_s16_z(svbool_t, svint16_t, int16_t);
18413__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u8_m)))
18414svuint8_t svqrshl_n_u8_m(svbool_t, svuint8_t, int8_t);
18415__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u32_m)))
18416svuint32_t svqrshl_n_u32_m(svbool_t, svuint32_t, int32_t);
18417__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u64_m)))
18418svuint64_t svqrshl_n_u64_m(svbool_t, svuint64_t, int64_t);
18419__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u16_m)))
18420svuint16_t svqrshl_n_u16_m(svbool_t, svuint16_t, int16_t);
18421__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u8_x)))
18422svuint8_t svqrshl_n_u8_x(svbool_t, svuint8_t, int8_t);
18423__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u32_x)))
18424svuint32_t svqrshl_n_u32_x(svbool_t, svuint32_t, int32_t);
18425__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u64_x)))
18426svuint64_t svqrshl_n_u64_x(svbool_t, svuint64_t, int64_t);
18427__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u16_x)))
18428svuint16_t svqrshl_n_u16_x(svbool_t, svuint16_t, int16_t);
18429__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u8_z)))
18430svuint8_t svqrshl_n_u8_z(svbool_t, svuint8_t, int8_t);
18431__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u32_z)))
18432svuint32_t svqrshl_n_u32_z(svbool_t, svuint32_t, int32_t);
18433__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u64_z)))
18434svuint64_t svqrshl_n_u64_z(svbool_t, svuint64_t, int64_t);
18435__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u16_z)))
18436svuint16_t svqrshl_n_u16_z(svbool_t, svuint16_t, int16_t);
18437__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s8_m)))
18438svint8_t svqrshl_s8_m(svbool_t, svint8_t, svint8_t);
18439__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s32_m)))
18440svint32_t svqrshl_s32_m(svbool_t, svint32_t, svint32_t);
18441__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s64_m)))
18442svint64_t svqrshl_s64_m(svbool_t, svint64_t, svint64_t);
18443__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s16_m)))
18444svint16_t svqrshl_s16_m(svbool_t, svint16_t, svint16_t);
18445__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s8_x)))
18446svint8_t svqrshl_s8_x(svbool_t, svint8_t, svint8_t);
18447__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s32_x)))
18448svint32_t svqrshl_s32_x(svbool_t, svint32_t, svint32_t);
18449__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s64_x)))
18450svint64_t svqrshl_s64_x(svbool_t, svint64_t, svint64_t);
18451__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s16_x)))
18452svint16_t svqrshl_s16_x(svbool_t, svint16_t, svint16_t);
18453__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s8_z)))
18454svint8_t svqrshl_s8_z(svbool_t, svint8_t, svint8_t);
18455__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s32_z)))
18456svint32_t svqrshl_s32_z(svbool_t, svint32_t, svint32_t);
18457__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s64_z)))
18458svint64_t svqrshl_s64_z(svbool_t, svint64_t, svint64_t);
18459__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s16_z)))
18460svint16_t svqrshl_s16_z(svbool_t, svint16_t, svint16_t);
18461__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u8_m)))
18462svuint8_t svqrshl_u8_m(svbool_t, svuint8_t, svint8_t);
18463__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u32_m)))
18464svuint32_t svqrshl_u32_m(svbool_t, svuint32_t, svint32_t);
18465__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u64_m)))
18466svuint64_t svqrshl_u64_m(svbool_t, svuint64_t, svint64_t);
18467__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u16_m)))
18468svuint16_t svqrshl_u16_m(svbool_t, svuint16_t, svint16_t);
18469__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u8_x)))
18470svuint8_t svqrshl_u8_x(svbool_t, svuint8_t, svint8_t);
18471__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u32_x)))
18472svuint32_t svqrshl_u32_x(svbool_t, svuint32_t, svint32_t);
18473__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u64_x)))
18474svuint64_t svqrshl_u64_x(svbool_t, svuint64_t, svint64_t);
18475__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u16_x)))
18476svuint16_t svqrshl_u16_x(svbool_t, svuint16_t, svint16_t);
18477__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u8_z)))
18478svuint8_t svqrshl_u8_z(svbool_t, svuint8_t, svint8_t);
18479__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u32_z)))
18480svuint32_t svqrshl_u32_z(svbool_t, svuint32_t, svint32_t);
18481__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u64_z)))
18482svuint64_t svqrshl_u64_z(svbool_t, svuint64_t, svint64_t);
18483__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u16_z)))
18484svuint16_t svqrshl_u16_z(svbool_t, svuint16_t, svint16_t);
18485__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnb_n_s32)))
18486svint16_t svqrshrnb_n_s32(svint32_t, uint64_t);
18487__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnb_n_s64)))
18488svint32_t svqrshrnb_n_s64(svint64_t, uint64_t);
18489__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnb_n_s16)))
18490svint8_t svqrshrnb_n_s16(svint16_t, uint64_t);
18491__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnb_n_u32)))
18492svuint16_t svqrshrnb_n_u32(svuint32_t, uint64_t);
18493__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnb_n_u64)))
18494svuint32_t svqrshrnb_n_u64(svuint64_t, uint64_t);
18495__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnb_n_u16)))
18496svuint8_t svqrshrnb_n_u16(svuint16_t, uint64_t);
18497__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnt_n_s32)))
18498svint16_t svqrshrnt_n_s32(svint16_t, svint32_t, uint64_t);
18499__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnt_n_s64)))
18500svint32_t svqrshrnt_n_s64(svint32_t, svint64_t, uint64_t);
18501__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnt_n_s16)))
18502svint8_t svqrshrnt_n_s16(svint8_t, svint16_t, uint64_t);
18503__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnt_n_u32)))
18504svuint16_t svqrshrnt_n_u32(svuint16_t, svuint32_t, uint64_t);
18505__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnt_n_u64)))
18506svuint32_t svqrshrnt_n_u64(svuint32_t, svuint64_t, uint64_t);
18507__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnt_n_u16)))
18508svuint8_t svqrshrnt_n_u16(svuint8_t, svuint16_t, uint64_t);
18509__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrunb_n_s32)))
18510svuint16_t svqrshrunb_n_s32(svint32_t, uint64_t);
18511__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrunb_n_s64)))
18512svuint32_t svqrshrunb_n_s64(svint64_t, uint64_t);
18513__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrunb_n_s16)))
18514svuint8_t svqrshrunb_n_s16(svint16_t, uint64_t);
18515__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrunt_n_s32)))
18516svuint16_t svqrshrunt_n_s32(svuint16_t, svint32_t, uint64_t);
18517__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrunt_n_s64)))
18518svuint32_t svqrshrunt_n_s64(svuint32_t, svint64_t, uint64_t);
18519__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrunt_n_s16)))
18520svuint8_t svqrshrunt_n_s16(svuint8_t, svint16_t, uint64_t);
18521__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s8_m)))
18522svint8_t svqshl_n_s8_m(svbool_t, svint8_t, int8_t);
18523__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s32_m)))
18524svint32_t svqshl_n_s32_m(svbool_t, svint32_t, int32_t);
18525__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s64_m)))
18526svint64_t svqshl_n_s64_m(svbool_t, svint64_t, int64_t);
18527__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s16_m)))
18528svint16_t svqshl_n_s16_m(svbool_t, svint16_t, int16_t);
18529__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s8_x)))
18530svint8_t svqshl_n_s8_x(svbool_t, svint8_t, int8_t);
18531__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s32_x)))
18532svint32_t svqshl_n_s32_x(svbool_t, svint32_t, int32_t);
18533__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s64_x)))
18534svint64_t svqshl_n_s64_x(svbool_t, svint64_t, int64_t);
18535__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s16_x)))
18536svint16_t svqshl_n_s16_x(svbool_t, svint16_t, int16_t);
18537__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s8_z)))
18538svint8_t svqshl_n_s8_z(svbool_t, svint8_t, int8_t);
18539__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s32_z)))
18540svint32_t svqshl_n_s32_z(svbool_t, svint32_t, int32_t);
18541__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s64_z)))
18542svint64_t svqshl_n_s64_z(svbool_t, svint64_t, int64_t);
18543__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s16_z)))
18544svint16_t svqshl_n_s16_z(svbool_t, svint16_t, int16_t);
18545__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u8_m)))
18546svuint8_t svqshl_n_u8_m(svbool_t, svuint8_t, int8_t);
18547__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u32_m)))
18548svuint32_t svqshl_n_u32_m(svbool_t, svuint32_t, int32_t);
18549__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u64_m)))
18550svuint64_t svqshl_n_u64_m(svbool_t, svuint64_t, int64_t);
18551__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u16_m)))
18552svuint16_t svqshl_n_u16_m(svbool_t, svuint16_t, int16_t);
18553__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u8_x)))
18554svuint8_t svqshl_n_u8_x(svbool_t, svuint8_t, int8_t);
18555__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u32_x)))
18556svuint32_t svqshl_n_u32_x(svbool_t, svuint32_t, int32_t);
18557__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u64_x)))
18558svuint64_t svqshl_n_u64_x(svbool_t, svuint64_t, int64_t);
18559__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u16_x)))
18560svuint16_t svqshl_n_u16_x(svbool_t, svuint16_t, int16_t);
18561__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u8_z)))
18562svuint8_t svqshl_n_u8_z(svbool_t, svuint8_t, int8_t);
18563__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u32_z)))
18564svuint32_t svqshl_n_u32_z(svbool_t, svuint32_t, int32_t);
18565__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u64_z)))
18566svuint64_t svqshl_n_u64_z(svbool_t, svuint64_t, int64_t);
18567__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u16_z)))
18568svuint16_t svqshl_n_u16_z(svbool_t, svuint16_t, int16_t);
18569__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s8_m)))
18570svint8_t svqshl_s8_m(svbool_t, svint8_t, svint8_t);
18571__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s32_m)))
18572svint32_t svqshl_s32_m(svbool_t, svint32_t, svint32_t);
18573__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s64_m)))
18574svint64_t svqshl_s64_m(svbool_t, svint64_t, svint64_t);
18575__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s16_m)))
18576svint16_t svqshl_s16_m(svbool_t, svint16_t, svint16_t);
18577__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s8_x)))
18578svint8_t svqshl_s8_x(svbool_t, svint8_t, svint8_t);
18579__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s32_x)))
18580svint32_t svqshl_s32_x(svbool_t, svint32_t, svint32_t);
18581__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s64_x)))
18582svint64_t svqshl_s64_x(svbool_t, svint64_t, svint64_t);
18583__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s16_x)))
18584svint16_t svqshl_s16_x(svbool_t, svint16_t, svint16_t);
18585__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s8_z)))
18586svint8_t svqshl_s8_z(svbool_t, svint8_t, svint8_t);
18587__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s32_z)))
18588svint32_t svqshl_s32_z(svbool_t, svint32_t, svint32_t);
18589__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s64_z)))
18590svint64_t svqshl_s64_z(svbool_t, svint64_t, svint64_t);
18591__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s16_z)))
18592svint16_t svqshl_s16_z(svbool_t, svint16_t, svint16_t);
18593__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u8_m)))
18594svuint8_t svqshl_u8_m(svbool_t, svuint8_t, svint8_t);
18595__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u32_m)))
18596svuint32_t svqshl_u32_m(svbool_t, svuint32_t, svint32_t);
18597__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u64_m)))
18598svuint64_t svqshl_u64_m(svbool_t, svuint64_t, svint64_t);
18599__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u16_m)))
18600svuint16_t svqshl_u16_m(svbool_t, svuint16_t, svint16_t);
18601__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u8_x)))
18602svuint8_t svqshl_u8_x(svbool_t, svuint8_t, svint8_t);
18603__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u32_x)))
18604svuint32_t svqshl_u32_x(svbool_t, svuint32_t, svint32_t);
18605__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u64_x)))
18606svuint64_t svqshl_u64_x(svbool_t, svuint64_t, svint64_t);
18607__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u16_x)))
18608svuint16_t svqshl_u16_x(svbool_t, svuint16_t, svint16_t);
18609__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u8_z)))
18610svuint8_t svqshl_u8_z(svbool_t, svuint8_t, svint8_t);
18611__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u32_z)))
18612svuint32_t svqshl_u32_z(svbool_t, svuint32_t, svint32_t);
18613__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u64_z)))
18614svuint64_t svqshl_u64_z(svbool_t, svuint64_t, svint64_t);
18615__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u16_z)))
18616svuint16_t svqshl_u16_z(svbool_t, svuint16_t, svint16_t);
18617__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s8_m)))
18618svuint8_t svqshlu_n_s8_m(svbool_t, svint8_t, uint64_t);
18619__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s32_m)))
18620svuint32_t svqshlu_n_s32_m(svbool_t, svint32_t, uint64_t);
18621__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s64_m)))
18622svuint64_t svqshlu_n_s64_m(svbool_t, svint64_t, uint64_t);
18623__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s16_m)))
18624svuint16_t svqshlu_n_s16_m(svbool_t, svint16_t, uint64_t);
18625__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s8_x)))
18626svuint8_t svqshlu_n_s8_x(svbool_t, svint8_t, uint64_t);
18627__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s32_x)))
18628svuint32_t svqshlu_n_s32_x(svbool_t, svint32_t, uint64_t);
18629__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s64_x)))
18630svuint64_t svqshlu_n_s64_x(svbool_t, svint64_t, uint64_t);
18631__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s16_x)))
18632svuint16_t svqshlu_n_s16_x(svbool_t, svint16_t, uint64_t);
18633__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s8_z)))
18634svuint8_t svqshlu_n_s8_z(svbool_t, svint8_t, uint64_t);
18635__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s32_z)))
18636svuint32_t svqshlu_n_s32_z(svbool_t, svint32_t, uint64_t);
18637__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s64_z)))
18638svuint64_t svqshlu_n_s64_z(svbool_t, svint64_t, uint64_t);
18639__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s16_z)))
18640svuint16_t svqshlu_n_s16_z(svbool_t, svint16_t, uint64_t);
18641__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnb_n_s32)))
18642svint16_t svqshrnb_n_s32(svint32_t, uint64_t);
18643__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnb_n_s64)))
18644svint32_t svqshrnb_n_s64(svint64_t, uint64_t);
18645__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnb_n_s16)))
18646svint8_t svqshrnb_n_s16(svint16_t, uint64_t);
18647__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnb_n_u32)))
18648svuint16_t svqshrnb_n_u32(svuint32_t, uint64_t);
18649__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnb_n_u64)))
18650svuint32_t svqshrnb_n_u64(svuint64_t, uint64_t);
18651__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnb_n_u16)))
18652svuint8_t svqshrnb_n_u16(svuint16_t, uint64_t);
18653__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnt_n_s32)))
18654svint16_t svqshrnt_n_s32(svint16_t, svint32_t, uint64_t);
18655__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnt_n_s64)))
18656svint32_t svqshrnt_n_s64(svint32_t, svint64_t, uint64_t);
18657__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnt_n_s16)))
18658svint8_t svqshrnt_n_s16(svint8_t, svint16_t, uint64_t);
18659__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnt_n_u32)))
18660svuint16_t svqshrnt_n_u32(svuint16_t, svuint32_t, uint64_t);
18661__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnt_n_u64)))
18662svuint32_t svqshrnt_n_u64(svuint32_t, svuint64_t, uint64_t);
18663__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnt_n_u16)))
18664svuint8_t svqshrnt_n_u16(svuint8_t, svuint16_t, uint64_t);
18665__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrunb_n_s32)))
18666svuint16_t svqshrunb_n_s32(svint32_t, uint64_t);
18667__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrunb_n_s64)))
18668svuint32_t svqshrunb_n_s64(svint64_t, uint64_t);
18669__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrunb_n_s16)))
18670svuint8_t svqshrunb_n_s16(svint16_t, uint64_t);
18671__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrunt_n_s32)))
18672svuint16_t svqshrunt_n_s32(svuint16_t, svint32_t, uint64_t);
18673__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrunt_n_s64)))
18674svuint32_t svqshrunt_n_s64(svuint32_t, svint64_t, uint64_t);
18675__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrunt_n_s16)))
18676svuint8_t svqshrunt_n_s16(svuint8_t, svint16_t, uint64_t);
18677__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s8_m)))
18678svint8_t svqsub_n_s8_m(svbool_t, svint8_t, int8_t);
18679__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s32_m)))
18680svint32_t svqsub_n_s32_m(svbool_t, svint32_t, int32_t);
18681__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s64_m)))
18682svint64_t svqsub_n_s64_m(svbool_t, svint64_t, int64_t);
18683__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s16_m)))
18684svint16_t svqsub_n_s16_m(svbool_t, svint16_t, int16_t);
18685__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s8_x)))
18686svint8_t svqsub_n_s8_x(svbool_t, svint8_t, int8_t);
18687__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s32_x)))
18688svint32_t svqsub_n_s32_x(svbool_t, svint32_t, int32_t);
18689__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s64_x)))
18690svint64_t svqsub_n_s64_x(svbool_t, svint64_t, int64_t);
18691__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s16_x)))
18692svint16_t svqsub_n_s16_x(svbool_t, svint16_t, int16_t);
18693__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s8_z)))
18694svint8_t svqsub_n_s8_z(svbool_t, svint8_t, int8_t);
18695__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s32_z)))
18696svint32_t svqsub_n_s32_z(svbool_t, svint32_t, int32_t);
18697__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s64_z)))
18698svint64_t svqsub_n_s64_z(svbool_t, svint64_t, int64_t);
18699__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s16_z)))
18700svint16_t svqsub_n_s16_z(svbool_t, svint16_t, int16_t);
18701__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u8_m)))
18702svuint8_t svqsub_n_u8_m(svbool_t, svuint8_t, uint8_t);
18703__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u32_m)))
18704svuint32_t svqsub_n_u32_m(svbool_t, svuint32_t, uint32_t);
18705__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u64_m)))
18706svuint64_t svqsub_n_u64_m(svbool_t, svuint64_t, uint64_t);
18707__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u16_m)))
18708svuint16_t svqsub_n_u16_m(svbool_t, svuint16_t, uint16_t);
18709__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u8_x)))
18710svuint8_t svqsub_n_u8_x(svbool_t, svuint8_t, uint8_t);
18711__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u32_x)))
18712svuint32_t svqsub_n_u32_x(svbool_t, svuint32_t, uint32_t);
18713__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u64_x)))
18714svuint64_t svqsub_n_u64_x(svbool_t, svuint64_t, uint64_t);
18715__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u16_x)))
18716svuint16_t svqsub_n_u16_x(svbool_t, svuint16_t, uint16_t);
18717__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u8_z)))
18718svuint8_t svqsub_n_u8_z(svbool_t, svuint8_t, uint8_t);
18719__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u32_z)))
18720svuint32_t svqsub_n_u32_z(svbool_t, svuint32_t, uint32_t);
18721__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u64_z)))
18722svuint64_t svqsub_n_u64_z(svbool_t, svuint64_t, uint64_t);
18723__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u16_z)))
18724svuint16_t svqsub_n_u16_z(svbool_t, svuint16_t, uint16_t);
18725__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s8_m)))
18726svint8_t svqsub_s8_m(svbool_t, svint8_t, svint8_t);
18727__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s32_m)))
18728svint32_t svqsub_s32_m(svbool_t, svint32_t, svint32_t);
18729__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s64_m)))
18730svint64_t svqsub_s64_m(svbool_t, svint64_t, svint64_t);
18731__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s16_m)))
18732svint16_t svqsub_s16_m(svbool_t, svint16_t, svint16_t);
18733__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s8_x)))
18734svint8_t svqsub_s8_x(svbool_t, svint8_t, svint8_t);
18735__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s32_x)))
18736svint32_t svqsub_s32_x(svbool_t, svint32_t, svint32_t);
18737__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s64_x)))
18738svint64_t svqsub_s64_x(svbool_t, svint64_t, svint64_t);
18739__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s16_x)))
18740svint16_t svqsub_s16_x(svbool_t, svint16_t, svint16_t);
18741__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s8_z)))
18742svint8_t svqsub_s8_z(svbool_t, svint8_t, svint8_t);
18743__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s32_z)))
18744svint32_t svqsub_s32_z(svbool_t, svint32_t, svint32_t);
18745__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s64_z)))
18746svint64_t svqsub_s64_z(svbool_t, svint64_t, svint64_t);
18747__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s16_z)))
18748svint16_t svqsub_s16_z(svbool_t, svint16_t, svint16_t);
18749__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u8_m)))
18750svuint8_t svqsub_u8_m(svbool_t, svuint8_t, svuint8_t);
18751__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u32_m)))
18752svuint32_t svqsub_u32_m(svbool_t, svuint32_t, svuint32_t);
18753__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u64_m)))
18754svuint64_t svqsub_u64_m(svbool_t, svuint64_t, svuint64_t);
18755__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u16_m)))
18756svuint16_t svqsub_u16_m(svbool_t, svuint16_t, svuint16_t);
18757__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u8_x)))
18758svuint8_t svqsub_u8_x(svbool_t, svuint8_t, svuint8_t);
18759__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u32_x)))
18760svuint32_t svqsub_u32_x(svbool_t, svuint32_t, svuint32_t);
18761__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u64_x)))
18762svuint64_t svqsub_u64_x(svbool_t, svuint64_t, svuint64_t);
18763__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u16_x)))
18764svuint16_t svqsub_u16_x(svbool_t, svuint16_t, svuint16_t);
18765__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u8_z)))
18766svuint8_t svqsub_u8_z(svbool_t, svuint8_t, svuint8_t);
18767__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u32_z)))
18768svuint32_t svqsub_u32_z(svbool_t, svuint32_t, svuint32_t);
18769__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u64_z)))
18770svuint64_t svqsub_u64_z(svbool_t, svuint64_t, svuint64_t);
18771__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u16_z)))
18772svuint16_t svqsub_u16_z(svbool_t, svuint16_t, svuint16_t);
18773__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s8_m)))
18774svint8_t svqsubr_n_s8_m(svbool_t, svint8_t, int8_t);
18775__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s32_m)))
18776svint32_t svqsubr_n_s32_m(svbool_t, svint32_t, int32_t);
18777__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s64_m)))
18778svint64_t svqsubr_n_s64_m(svbool_t, svint64_t, int64_t);
18779__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s16_m)))
18780svint16_t svqsubr_n_s16_m(svbool_t, svint16_t, int16_t);
18781__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s8_x)))
18782svint8_t svqsubr_n_s8_x(svbool_t, svint8_t, int8_t);
18783__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s32_x)))
18784svint32_t svqsubr_n_s32_x(svbool_t, svint32_t, int32_t);
18785__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s64_x)))
18786svint64_t svqsubr_n_s64_x(svbool_t, svint64_t, int64_t);
18787__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s16_x)))
18788svint16_t svqsubr_n_s16_x(svbool_t, svint16_t, int16_t);
18789__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s8_z)))
18790svint8_t svqsubr_n_s8_z(svbool_t, svint8_t, int8_t);
18791__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s32_z)))
18792svint32_t svqsubr_n_s32_z(svbool_t, svint32_t, int32_t);
18793__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s64_z)))
18794svint64_t svqsubr_n_s64_z(svbool_t, svint64_t, int64_t);
18795__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s16_z)))
18796svint16_t svqsubr_n_s16_z(svbool_t, svint16_t, int16_t);
18797__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u8_m)))
18798svuint8_t svqsubr_n_u8_m(svbool_t, svuint8_t, uint8_t);
18799__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u32_m)))
18800svuint32_t svqsubr_n_u32_m(svbool_t, svuint32_t, uint32_t);
18801__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u64_m)))
18802svuint64_t svqsubr_n_u64_m(svbool_t, svuint64_t, uint64_t);
18803__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u16_m)))
18804svuint16_t svqsubr_n_u16_m(svbool_t, svuint16_t, uint16_t);
18805__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u8_x)))
18806svuint8_t svqsubr_n_u8_x(svbool_t, svuint8_t, uint8_t);
18807__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u32_x)))
18808svuint32_t svqsubr_n_u32_x(svbool_t, svuint32_t, uint32_t);
18809__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u64_x)))
18810svuint64_t svqsubr_n_u64_x(svbool_t, svuint64_t, uint64_t);
18811__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u16_x)))
18812svuint16_t svqsubr_n_u16_x(svbool_t, svuint16_t, uint16_t);
18813__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u8_z)))
18814svuint8_t svqsubr_n_u8_z(svbool_t, svuint8_t, uint8_t);
18815__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u32_z)))
18816svuint32_t svqsubr_n_u32_z(svbool_t, svuint32_t, uint32_t);
18817__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u64_z)))
18818svuint64_t svqsubr_n_u64_z(svbool_t, svuint64_t, uint64_t);
18819__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u16_z)))
18820svuint16_t svqsubr_n_u16_z(svbool_t, svuint16_t, uint16_t);
18821__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s8_m)))
18822svint8_t svqsubr_s8_m(svbool_t, svint8_t, svint8_t);
18823__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s32_m)))
18824svint32_t svqsubr_s32_m(svbool_t, svint32_t, svint32_t);
18825__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s64_m)))
18826svint64_t svqsubr_s64_m(svbool_t, svint64_t, svint64_t);
18827__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s16_m)))
18828svint16_t svqsubr_s16_m(svbool_t, svint16_t, svint16_t);
18829__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s8_x)))
18830svint8_t svqsubr_s8_x(svbool_t, svint8_t, svint8_t);
18831__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s32_x)))
18832svint32_t svqsubr_s32_x(svbool_t, svint32_t, svint32_t);
18833__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s64_x)))
18834svint64_t svqsubr_s64_x(svbool_t, svint64_t, svint64_t);
18835__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s16_x)))
18836svint16_t svqsubr_s16_x(svbool_t, svint16_t, svint16_t);
18837__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s8_z)))
18838svint8_t svqsubr_s8_z(svbool_t, svint8_t, svint8_t);
18839__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s32_z)))
18840svint32_t svqsubr_s32_z(svbool_t, svint32_t, svint32_t);
18841__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s64_z)))
18842svint64_t svqsubr_s64_z(svbool_t, svint64_t, svint64_t);
18843__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s16_z)))
18844svint16_t svqsubr_s16_z(svbool_t, svint16_t, svint16_t);
18845__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u8_m)))
18846svuint8_t svqsubr_u8_m(svbool_t, svuint8_t, svuint8_t);
18847__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u32_m)))
18848svuint32_t svqsubr_u32_m(svbool_t, svuint32_t, svuint32_t);
18849__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u64_m)))
18850svuint64_t svqsubr_u64_m(svbool_t, svuint64_t, svuint64_t);
18851__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u16_m)))
18852svuint16_t svqsubr_u16_m(svbool_t, svuint16_t, svuint16_t);
18853__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u8_x)))
18854svuint8_t svqsubr_u8_x(svbool_t, svuint8_t, svuint8_t);
18855__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u32_x)))
18856svuint32_t svqsubr_u32_x(svbool_t, svuint32_t, svuint32_t);
18857__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u64_x)))
18858svuint64_t svqsubr_u64_x(svbool_t, svuint64_t, svuint64_t);
18859__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u16_x)))
18860svuint16_t svqsubr_u16_x(svbool_t, svuint16_t, svuint16_t);
18861__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u8_z)))
18862svuint8_t svqsubr_u8_z(svbool_t, svuint8_t, svuint8_t);
18863__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u32_z)))
18864svuint32_t svqsubr_u32_z(svbool_t, svuint32_t, svuint32_t);
18865__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u64_z)))
18866svuint64_t svqsubr_u64_z(svbool_t, svuint64_t, svuint64_t);
18867__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u16_z)))
18868svuint16_t svqsubr_u16_z(svbool_t, svuint16_t, svuint16_t);
18869__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnb_s32)))
18870svint16_t svqxtnb_s32(svint32_t);
18871__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnb_s64)))
18872svint32_t svqxtnb_s64(svint64_t);
18873__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnb_s16)))
18874svint8_t svqxtnb_s16(svint16_t);
18875__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnb_u32)))
18876svuint16_t svqxtnb_u32(svuint32_t);
18877__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnb_u64)))
18878svuint32_t svqxtnb_u64(svuint64_t);
18879__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnb_u16)))
18880svuint8_t svqxtnb_u16(svuint16_t);
18881__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnt_s32)))
18882svint16_t svqxtnt_s32(svint16_t, svint32_t);
18883__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnt_s64)))
18884svint32_t svqxtnt_s64(svint32_t, svint64_t);
18885__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnt_s16)))
18886svint8_t svqxtnt_s16(svint8_t, svint16_t);
18887__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnt_u32)))
18888svuint16_t svqxtnt_u32(svuint16_t, svuint32_t);
18889__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnt_u64)))
18890svuint32_t svqxtnt_u64(svuint32_t, svuint64_t);
18891__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnt_u16)))
18892svuint8_t svqxtnt_u16(svuint8_t, svuint16_t);
18893__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtunb_s32)))
18894svuint16_t svqxtunb_s32(svint32_t);
18895__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtunb_s64)))
18896svuint32_t svqxtunb_s64(svint64_t);
18897__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtunb_s16)))
18898svuint8_t svqxtunb_s16(svint16_t);
18899__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtunt_s32)))
18900svuint16_t svqxtunt_s32(svuint16_t, svint32_t);
18901__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtunt_s64)))
18902svuint32_t svqxtunt_s64(svuint32_t, svint64_t);
18903__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtunt_s16)))
18904svuint8_t svqxtunt_s16(svuint8_t, svint16_t);
18905__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_n_u32)))
18906svuint16_t svraddhnb_n_u32(svuint32_t, uint32_t);
18907__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_n_u64)))
18908svuint32_t svraddhnb_n_u64(svuint64_t, uint64_t);
18909__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_n_u16)))
18910svuint8_t svraddhnb_n_u16(svuint16_t, uint16_t);
18911__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_n_s32)))
18912svint16_t svraddhnb_n_s32(svint32_t, int32_t);
18913__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_n_s64)))
18914svint32_t svraddhnb_n_s64(svint64_t, int64_t);
18915__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_n_s16)))
18916svint8_t svraddhnb_n_s16(svint16_t, int16_t);
18917__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_u32)))
18918svuint16_t svraddhnb_u32(svuint32_t, svuint32_t);
18919__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_u64)))
18920svuint32_t svraddhnb_u64(svuint64_t, svuint64_t);
18921__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_u16)))
18922svuint8_t svraddhnb_u16(svuint16_t, svuint16_t);
18923__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_s32)))
18924svint16_t svraddhnb_s32(svint32_t, svint32_t);
18925__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_s64)))
18926svint32_t svraddhnb_s64(svint64_t, svint64_t);
18927__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_s16)))
18928svint8_t svraddhnb_s16(svint16_t, svint16_t);
18929__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_n_u32)))
18930svuint16_t svraddhnt_n_u32(svuint16_t, svuint32_t, uint32_t);
18931__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_n_u64)))
18932svuint32_t svraddhnt_n_u64(svuint32_t, svuint64_t, uint64_t);
18933__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_n_u16)))
18934svuint8_t svraddhnt_n_u16(svuint8_t, svuint16_t, uint16_t);
18935__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_n_s32)))
18936svint16_t svraddhnt_n_s32(svint16_t, svint32_t, int32_t);
18937__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_n_s64)))
18938svint32_t svraddhnt_n_s64(svint32_t, svint64_t, int64_t);
18939__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_n_s16)))
18940svint8_t svraddhnt_n_s16(svint8_t, svint16_t, int16_t);
18941__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_u32)))
18942svuint16_t svraddhnt_u32(svuint16_t, svuint32_t, svuint32_t);
18943__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_u64)))
18944svuint32_t svraddhnt_u64(svuint32_t, svuint64_t, svuint64_t);
18945__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_u16)))
18946svuint8_t svraddhnt_u16(svuint8_t, svuint16_t, svuint16_t);
18947__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_s32)))
18948svint16_t svraddhnt_s32(svint16_t, svint32_t, svint32_t);
18949__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_s64)))
18950svint32_t svraddhnt_s64(svint32_t, svint64_t, svint64_t);
18951__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_s16)))
18952svint8_t svraddhnt_s16(svint8_t, svint16_t, svint16_t);
18953__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrecpe_u32_m)))
18954svuint32_t svrecpe_u32_m(svuint32_t, svbool_t, svuint32_t);
18955__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrecpe_u32_x)))
18956svuint32_t svrecpe_u32_x(svbool_t, svuint32_t);
18957__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrecpe_u32_z)))
18958svuint32_t svrecpe_u32_z(svbool_t, svuint32_t);
18959__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s8_m)))
18960svint8_t svrhadd_n_s8_m(svbool_t, svint8_t, int8_t);
18961__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s32_m)))
18962svint32_t svrhadd_n_s32_m(svbool_t, svint32_t, int32_t);
18963__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s64_m)))
18964svint64_t svrhadd_n_s64_m(svbool_t, svint64_t, int64_t);
18965__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s16_m)))
18966svint16_t svrhadd_n_s16_m(svbool_t, svint16_t, int16_t);
18967__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s8_x)))
18968svint8_t svrhadd_n_s8_x(svbool_t, svint8_t, int8_t);
18969__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s32_x)))
18970svint32_t svrhadd_n_s32_x(svbool_t, svint32_t, int32_t);
18971__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s64_x)))
18972svint64_t svrhadd_n_s64_x(svbool_t, svint64_t, int64_t);
18973__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s16_x)))
18974svint16_t svrhadd_n_s16_x(svbool_t, svint16_t, int16_t);
18975__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s8_z)))
18976svint8_t svrhadd_n_s8_z(svbool_t, svint8_t, int8_t);
18977__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s32_z)))
18978svint32_t svrhadd_n_s32_z(svbool_t, svint32_t, int32_t);
18979__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s64_z)))
18980svint64_t svrhadd_n_s64_z(svbool_t, svint64_t, int64_t);
18981__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s16_z)))
18982svint16_t svrhadd_n_s16_z(svbool_t, svint16_t, int16_t);
18983__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u8_m)))
18984svuint8_t svrhadd_n_u8_m(svbool_t, svuint8_t, uint8_t);
18985__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u32_m)))
18986svuint32_t svrhadd_n_u32_m(svbool_t, svuint32_t, uint32_t);
18987__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u64_m)))
18988svuint64_t svrhadd_n_u64_m(svbool_t, svuint64_t, uint64_t);
18989__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u16_m)))
18990svuint16_t svrhadd_n_u16_m(svbool_t, svuint16_t, uint16_t);
18991__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u8_x)))
18992svuint8_t svrhadd_n_u8_x(svbool_t, svuint8_t, uint8_t);
18993__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u32_x)))
18994svuint32_t svrhadd_n_u32_x(svbool_t, svuint32_t, uint32_t);
18995__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u64_x)))
18996svuint64_t svrhadd_n_u64_x(svbool_t, svuint64_t, uint64_t);
18997__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u16_x)))
18998svuint16_t svrhadd_n_u16_x(svbool_t, svuint16_t, uint16_t);
18999__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u8_z)))
19000svuint8_t svrhadd_n_u8_z(svbool_t, svuint8_t, uint8_t);
19001__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u32_z)))
19002svuint32_t svrhadd_n_u32_z(svbool_t, svuint32_t, uint32_t);
19003__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u64_z)))
19004svuint64_t svrhadd_n_u64_z(svbool_t, svuint64_t, uint64_t);
19005__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u16_z)))
19006svuint16_t svrhadd_n_u16_z(svbool_t, svuint16_t, uint16_t);
19007__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s8_m)))
19008svint8_t svrhadd_s8_m(svbool_t, svint8_t, svint8_t);
19009__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s32_m)))
19010svint32_t svrhadd_s32_m(svbool_t, svint32_t, svint32_t);
19011__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s64_m)))
19012svint64_t svrhadd_s64_m(svbool_t, svint64_t, svint64_t);
19013__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s16_m)))
19014svint16_t svrhadd_s16_m(svbool_t, svint16_t, svint16_t);
19015__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s8_x)))
19016svint8_t svrhadd_s8_x(svbool_t, svint8_t, svint8_t);
19017__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s32_x)))
19018svint32_t svrhadd_s32_x(svbool_t, svint32_t, svint32_t);
19019__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s64_x)))
19020svint64_t svrhadd_s64_x(svbool_t, svint64_t, svint64_t);
19021__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s16_x)))
19022svint16_t svrhadd_s16_x(svbool_t, svint16_t, svint16_t);
19023__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s8_z)))
19024svint8_t svrhadd_s8_z(svbool_t, svint8_t, svint8_t);
19025__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s32_z)))
19026svint32_t svrhadd_s32_z(svbool_t, svint32_t, svint32_t);
19027__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s64_z)))
19028svint64_t svrhadd_s64_z(svbool_t, svint64_t, svint64_t);
19029__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s16_z)))
19030svint16_t svrhadd_s16_z(svbool_t, svint16_t, svint16_t);
19031__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u8_m)))
19032svuint8_t svrhadd_u8_m(svbool_t, svuint8_t, svuint8_t);
19033__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u32_m)))
19034svuint32_t svrhadd_u32_m(svbool_t, svuint32_t, svuint32_t);
19035__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u64_m)))
19036svuint64_t svrhadd_u64_m(svbool_t, svuint64_t, svuint64_t);
19037__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u16_m)))
19038svuint16_t svrhadd_u16_m(svbool_t, svuint16_t, svuint16_t);
19039__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u8_x)))
19040svuint8_t svrhadd_u8_x(svbool_t, svuint8_t, svuint8_t);
19041__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u32_x)))
19042svuint32_t svrhadd_u32_x(svbool_t, svuint32_t, svuint32_t);
19043__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u64_x)))
19044svuint64_t svrhadd_u64_x(svbool_t, svuint64_t, svuint64_t);
19045__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u16_x)))
19046svuint16_t svrhadd_u16_x(svbool_t, svuint16_t, svuint16_t);
19047__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u8_z)))
19048svuint8_t svrhadd_u8_z(svbool_t, svuint8_t, svuint8_t);
19049__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u32_z)))
19050svuint32_t svrhadd_u32_z(svbool_t, svuint32_t, svuint32_t);
19051__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u64_z)))
19052svuint64_t svrhadd_u64_z(svbool_t, svuint64_t, svuint64_t);
19053__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u16_z)))
19054svuint16_t svrhadd_u16_z(svbool_t, svuint16_t, svuint16_t);
19055__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s8_m)))
19056svint8_t svrshl_n_s8_m(svbool_t, svint8_t, int8_t);
19057__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s32_m)))
19058svint32_t svrshl_n_s32_m(svbool_t, svint32_t, int32_t);
19059__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s64_m)))
19060svint64_t svrshl_n_s64_m(svbool_t, svint64_t, int64_t);
19061__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s16_m)))
19062svint16_t svrshl_n_s16_m(svbool_t, svint16_t, int16_t);
19063__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s8_x)))
19064svint8_t svrshl_n_s8_x(svbool_t, svint8_t, int8_t);
19065__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s32_x)))
19066svint32_t svrshl_n_s32_x(svbool_t, svint32_t, int32_t);
19067__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s64_x)))
19068svint64_t svrshl_n_s64_x(svbool_t, svint64_t, int64_t);
19069__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s16_x)))
19070svint16_t svrshl_n_s16_x(svbool_t, svint16_t, int16_t);
19071__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s8_z)))
19072svint8_t svrshl_n_s8_z(svbool_t, svint8_t, int8_t);
19073__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s32_z)))
19074svint32_t svrshl_n_s32_z(svbool_t, svint32_t, int32_t);
19075__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s64_z)))
19076svint64_t svrshl_n_s64_z(svbool_t, svint64_t, int64_t);
19077__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s16_z)))
19078svint16_t svrshl_n_s16_z(svbool_t, svint16_t, int16_t);
19079__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u8_m)))
19080svuint8_t svrshl_n_u8_m(svbool_t, svuint8_t, int8_t);
19081__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u32_m)))
19082svuint32_t svrshl_n_u32_m(svbool_t, svuint32_t, int32_t);
19083__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u64_m)))
19084svuint64_t svrshl_n_u64_m(svbool_t, svuint64_t, int64_t);
19085__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u16_m)))
19086svuint16_t svrshl_n_u16_m(svbool_t, svuint16_t, int16_t);
19087__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u8_x)))
19088svuint8_t svrshl_n_u8_x(svbool_t, svuint8_t, int8_t);
19089__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u32_x)))
19090svuint32_t svrshl_n_u32_x(svbool_t, svuint32_t, int32_t);
19091__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u64_x)))
19092svuint64_t svrshl_n_u64_x(svbool_t, svuint64_t, int64_t);
19093__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u16_x)))
19094svuint16_t svrshl_n_u16_x(svbool_t, svuint16_t, int16_t);
19095__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u8_z)))
19096svuint8_t svrshl_n_u8_z(svbool_t, svuint8_t, int8_t);
19097__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u32_z)))
19098svuint32_t svrshl_n_u32_z(svbool_t, svuint32_t, int32_t);
19099__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u64_z)))
19100svuint64_t svrshl_n_u64_z(svbool_t, svuint64_t, int64_t);
19101__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u16_z)))
19102svuint16_t svrshl_n_u16_z(svbool_t, svuint16_t, int16_t);
19103__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s8_m)))
19104svint8_t svrshl_s8_m(svbool_t, svint8_t, svint8_t);
19105__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s32_m)))
19106svint32_t svrshl_s32_m(svbool_t, svint32_t, svint32_t);
19107__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s64_m)))
19108svint64_t svrshl_s64_m(svbool_t, svint64_t, svint64_t);
19109__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s16_m)))
19110svint16_t svrshl_s16_m(svbool_t, svint16_t, svint16_t);
19111__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s8_x)))
19112svint8_t svrshl_s8_x(svbool_t, svint8_t, svint8_t);
19113__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s32_x)))
19114svint32_t svrshl_s32_x(svbool_t, svint32_t, svint32_t);
19115__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s64_x)))
19116svint64_t svrshl_s64_x(svbool_t, svint64_t, svint64_t);
19117__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s16_x)))
19118svint16_t svrshl_s16_x(svbool_t, svint16_t, svint16_t);
19119__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s8_z)))
19120svint8_t svrshl_s8_z(svbool_t, svint8_t, svint8_t);
19121__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s32_z)))
19122svint32_t svrshl_s32_z(svbool_t, svint32_t, svint32_t);
19123__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s64_z)))
19124svint64_t svrshl_s64_z(svbool_t, svint64_t, svint64_t);
19125__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s16_z)))
19126svint16_t svrshl_s16_z(svbool_t, svint16_t, svint16_t);
19127__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u8_m)))
19128svuint8_t svrshl_u8_m(svbool_t, svuint8_t, svint8_t);
19129__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u32_m)))
19130svuint32_t svrshl_u32_m(svbool_t, svuint32_t, svint32_t);
19131__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u64_m)))
19132svuint64_t svrshl_u64_m(svbool_t, svuint64_t, svint64_t);
19133__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u16_m)))
19134svuint16_t svrshl_u16_m(svbool_t, svuint16_t, svint16_t);
19135__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u8_x)))
19136svuint8_t svrshl_u8_x(svbool_t, svuint8_t, svint8_t);
19137__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u32_x)))
19138svuint32_t svrshl_u32_x(svbool_t, svuint32_t, svint32_t);
19139__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u64_x)))
19140svuint64_t svrshl_u64_x(svbool_t, svuint64_t, svint64_t);
19141__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u16_x)))
19142svuint16_t svrshl_u16_x(svbool_t, svuint16_t, svint16_t);
19143__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u8_z)))
19144svuint8_t svrshl_u8_z(svbool_t, svuint8_t, svint8_t);
19145__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u32_z)))
19146svuint32_t svrshl_u32_z(svbool_t, svuint32_t, svint32_t);
19147__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u64_z)))
19148svuint64_t svrshl_u64_z(svbool_t, svuint64_t, svint64_t);
19149__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u16_z)))
19150svuint16_t svrshl_u16_z(svbool_t, svuint16_t, svint16_t);
19151__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s8_m)))
19152svint8_t svrshr_n_s8_m(svbool_t, svint8_t, uint64_t);
19153__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s32_m)))
19154svint32_t svrshr_n_s32_m(svbool_t, svint32_t, uint64_t);
19155__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s64_m)))
19156svint64_t svrshr_n_s64_m(svbool_t, svint64_t, uint64_t);
19157__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s16_m)))
19158svint16_t svrshr_n_s16_m(svbool_t, svint16_t, uint64_t);
19159__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u8_m)))
19160svuint8_t svrshr_n_u8_m(svbool_t, svuint8_t, uint64_t);
19161__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u32_m)))
19162svuint32_t svrshr_n_u32_m(svbool_t, svuint32_t, uint64_t);
19163__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u64_m)))
19164svuint64_t svrshr_n_u64_m(svbool_t, svuint64_t, uint64_t);
19165__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u16_m)))
19166svuint16_t svrshr_n_u16_m(svbool_t, svuint16_t, uint64_t);
19167__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s8_x)))
19168svint8_t svrshr_n_s8_x(svbool_t, svint8_t, uint64_t);
19169__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s32_x)))
19170svint32_t svrshr_n_s32_x(svbool_t, svint32_t, uint64_t);
19171__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s64_x)))
19172svint64_t svrshr_n_s64_x(svbool_t, svint64_t, uint64_t);
19173__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s16_x)))
19174svint16_t svrshr_n_s16_x(svbool_t, svint16_t, uint64_t);
19175__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u8_x)))
19176svuint8_t svrshr_n_u8_x(svbool_t, svuint8_t, uint64_t);
19177__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u32_x)))
19178svuint32_t svrshr_n_u32_x(svbool_t, svuint32_t, uint64_t);
19179__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u64_x)))
19180svuint64_t svrshr_n_u64_x(svbool_t, svuint64_t, uint64_t);
19181__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u16_x)))
19182svuint16_t svrshr_n_u16_x(svbool_t, svuint16_t, uint64_t);
19183__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s8_z)))
19184svint8_t svrshr_n_s8_z(svbool_t, svint8_t, uint64_t);
19185__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s32_z)))
19186svint32_t svrshr_n_s32_z(svbool_t, svint32_t, uint64_t);
19187__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s64_z)))
19188svint64_t svrshr_n_s64_z(svbool_t, svint64_t, uint64_t);
19189__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s16_z)))
19190svint16_t svrshr_n_s16_z(svbool_t, svint16_t, uint64_t);
19191__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u8_z)))
19192svuint8_t svrshr_n_u8_z(svbool_t, svuint8_t, uint64_t);
19193__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u32_z)))
19194svuint32_t svrshr_n_u32_z(svbool_t, svuint32_t, uint64_t);
19195__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u64_z)))
19196svuint64_t svrshr_n_u64_z(svbool_t, svuint64_t, uint64_t);
19197__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u16_z)))
19198svuint16_t svrshr_n_u16_z(svbool_t, svuint16_t, uint64_t);
19199__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnb_n_u32)))
19200svuint16_t svrshrnb_n_u32(svuint32_t, uint64_t);
19201__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnb_n_u64)))
19202svuint32_t svrshrnb_n_u64(svuint64_t, uint64_t);
19203__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnb_n_u16)))
19204svuint8_t svrshrnb_n_u16(svuint16_t, uint64_t);
19205__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnb_n_s32)))
19206svint16_t svrshrnb_n_s32(svint32_t, uint64_t);
19207__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnb_n_s64)))
19208svint32_t svrshrnb_n_s64(svint64_t, uint64_t);
19209__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnb_n_s16)))
19210svint8_t svrshrnb_n_s16(svint16_t, uint64_t);
19211__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnt_n_u32)))
19212svuint16_t svrshrnt_n_u32(svuint16_t, svuint32_t, uint64_t);
19213__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnt_n_u64)))
19214svuint32_t svrshrnt_n_u64(svuint32_t, svuint64_t, uint64_t);
19215__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnt_n_u16)))
19216svuint8_t svrshrnt_n_u16(svuint8_t, svuint16_t, uint64_t);
19217__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnt_n_s32)))
19218svint16_t svrshrnt_n_s32(svint16_t, svint32_t, uint64_t);
19219__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnt_n_s64)))
19220svint32_t svrshrnt_n_s64(svint32_t, svint64_t, uint64_t);
19221__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnt_n_s16)))
19222svint8_t svrshrnt_n_s16(svint8_t, svint16_t, uint64_t);
19223__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsqrte_u32_m)))
19224svuint32_t svrsqrte_u32_m(svuint32_t, svbool_t, svuint32_t);
19225__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsqrte_u32_x)))
19226svuint32_t svrsqrte_u32_x(svbool_t, svuint32_t);
19227__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsqrte_u32_z)))
19228svuint32_t svrsqrte_u32_z(svbool_t, svuint32_t);
19229__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_s8)))
19230svint8_t svrsra_n_s8(svint8_t, svint8_t, uint64_t);
19231__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_s32)))
19232svint32_t svrsra_n_s32(svint32_t, svint32_t, uint64_t);
19233__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_s64)))
19234svint64_t svrsra_n_s64(svint64_t, svint64_t, uint64_t);
19235__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_s16)))
19236svint16_t svrsra_n_s16(svint16_t, svint16_t, uint64_t);
19237__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_u8)))
19238svuint8_t svrsra_n_u8(svuint8_t, svuint8_t, uint64_t);
19239__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_u32)))
19240svuint32_t svrsra_n_u32(svuint32_t, svuint32_t, uint64_t);
19241__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_u64)))
19242svuint64_t svrsra_n_u64(svuint64_t, svuint64_t, uint64_t);
19243__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_u16)))
19244svuint16_t svrsra_n_u16(svuint16_t, svuint16_t, uint64_t);
19245__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_n_u32)))
19246svuint16_t svrsubhnb_n_u32(svuint32_t, uint32_t);
19247__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_n_u64)))
19248svuint32_t svrsubhnb_n_u64(svuint64_t, uint64_t);
19249__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_n_u16)))
19250svuint8_t svrsubhnb_n_u16(svuint16_t, uint16_t);
19251__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_n_s32)))
19252svint16_t svrsubhnb_n_s32(svint32_t, int32_t);
19253__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_n_s64)))
19254svint32_t svrsubhnb_n_s64(svint64_t, int64_t);
19255__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_n_s16)))
19256svint8_t svrsubhnb_n_s16(svint16_t, int16_t);
19257__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_u32)))
19258svuint16_t svrsubhnb_u32(svuint32_t, svuint32_t);
19259__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_u64)))
19260svuint32_t svrsubhnb_u64(svuint64_t, svuint64_t);
19261__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_u16)))
19262svuint8_t svrsubhnb_u16(svuint16_t, svuint16_t);
19263__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_s32)))
19264svint16_t svrsubhnb_s32(svint32_t, svint32_t);
19265__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_s64)))
19266svint32_t svrsubhnb_s64(svint64_t, svint64_t);
19267__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_s16)))
19268svint8_t svrsubhnb_s16(svint16_t, svint16_t);
19269__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_n_u32)))
19270svuint16_t svrsubhnt_n_u32(svuint16_t, svuint32_t, uint32_t);
19271__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_n_u64)))
19272svuint32_t svrsubhnt_n_u64(svuint32_t, svuint64_t, uint64_t);
19273__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_n_u16)))
19274svuint8_t svrsubhnt_n_u16(svuint8_t, svuint16_t, uint16_t);
19275__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_n_s32)))
19276svint16_t svrsubhnt_n_s32(svint16_t, svint32_t, int32_t);
19277__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_n_s64)))
19278svint32_t svrsubhnt_n_s64(svint32_t, svint64_t, int64_t);
19279__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_n_s16)))
19280svint8_t svrsubhnt_n_s16(svint8_t, svint16_t, int16_t);
19281__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_u32)))
19282svuint16_t svrsubhnt_u32(svuint16_t, svuint32_t, svuint32_t);
19283__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_u64)))
19284svuint32_t svrsubhnt_u64(svuint32_t, svuint64_t, svuint64_t);
19285__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_u16)))
19286svuint8_t svrsubhnt_u16(svuint8_t, svuint16_t, svuint16_t);
19287__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_s32)))
19288svint16_t svrsubhnt_s32(svint16_t, svint32_t, svint32_t);
19289__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_s64)))
19290svint32_t svrsubhnt_s64(svint32_t, svint64_t, svint64_t);
19291__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_s16)))
19292svint8_t svrsubhnt_s16(svint8_t, svint16_t, svint16_t);
19293__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclb_n_u32)))
19294svuint32_t svsbclb_n_u32(svuint32_t, svuint32_t, uint32_t);
19295__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclb_n_u64)))
19296svuint64_t svsbclb_n_u64(svuint64_t, svuint64_t, uint64_t);
19297__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclb_u32)))
19298svuint32_t svsbclb_u32(svuint32_t, svuint32_t, svuint32_t);
19299__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclb_u64)))
19300svuint64_t svsbclb_u64(svuint64_t, svuint64_t, svuint64_t);
19301__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclt_n_u32)))
19302svuint32_t svsbclt_n_u32(svuint32_t, svuint32_t, uint32_t);
19303__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclt_n_u64)))
19304svuint64_t svsbclt_n_u64(svuint64_t, svuint64_t, uint64_t);
19305__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclt_u32)))
19306svuint32_t svsbclt_u32(svuint32_t, svuint32_t, svuint32_t);
19307__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclt_u64)))
19308svuint64_t svsbclt_u64(svuint64_t, svuint64_t, svuint64_t);
19309__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllb_n_s32)))
19310svint32_t svshllb_n_s32(svint16_t, uint64_t);
19311__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllb_n_s64)))
19312svint64_t svshllb_n_s64(svint32_t, uint64_t);
19313__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllb_n_s16)))
19314svint16_t svshllb_n_s16(svint8_t, uint64_t);
19315__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllb_n_u32)))
19316svuint32_t svshllb_n_u32(svuint16_t, uint64_t);
19317__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllb_n_u64)))
19318svuint64_t svshllb_n_u64(svuint32_t, uint64_t);
19319__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllb_n_u16)))
19320svuint16_t svshllb_n_u16(svuint8_t, uint64_t);
19321__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllt_n_s32)))
19322svint32_t svshllt_n_s32(svint16_t, uint64_t);
19323__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllt_n_s64)))
19324svint64_t svshllt_n_s64(svint32_t, uint64_t);
19325__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllt_n_s16)))
19326svint16_t svshllt_n_s16(svint8_t, uint64_t);
19327__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllt_n_u32)))
19328svuint32_t svshllt_n_u32(svuint16_t, uint64_t);
19329__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllt_n_u64)))
19330svuint64_t svshllt_n_u64(svuint32_t, uint64_t);
19331__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllt_n_u16)))
19332svuint16_t svshllt_n_u16(svuint8_t, uint64_t);
19333__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnb_n_u32)))
19334svuint16_t svshrnb_n_u32(svuint32_t, uint64_t);
19335__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnb_n_u64)))
19336svuint32_t svshrnb_n_u64(svuint64_t, uint64_t);
19337__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnb_n_u16)))
19338svuint8_t svshrnb_n_u16(svuint16_t, uint64_t);
19339__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnb_n_s32)))
19340svint16_t svshrnb_n_s32(svint32_t, uint64_t);
19341__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnb_n_s64)))
19342svint32_t svshrnb_n_s64(svint64_t, uint64_t);
19343__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnb_n_s16)))
19344svint8_t svshrnb_n_s16(svint16_t, uint64_t);
19345__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnt_n_u32)))
19346svuint16_t svshrnt_n_u32(svuint16_t, svuint32_t, uint64_t);
19347__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnt_n_u64)))
19348svuint32_t svshrnt_n_u64(svuint32_t, svuint64_t, uint64_t);
19349__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnt_n_u16)))
19350svuint8_t svshrnt_n_u16(svuint8_t, svuint16_t, uint64_t);
19351__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnt_n_s32)))
19352svint16_t svshrnt_n_s32(svint16_t, svint32_t, uint64_t);
19353__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnt_n_s64)))
19354svint32_t svshrnt_n_s64(svint32_t, svint64_t, uint64_t);
19355__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnt_n_s16)))
19356svint8_t svshrnt_n_s16(svint8_t, svint16_t, uint64_t);
19357__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_u8)))
19358svuint8_t svsli_n_u8(svuint8_t, svuint8_t, uint64_t);
19359__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_u32)))
19360svuint32_t svsli_n_u32(svuint32_t, svuint32_t, uint64_t);
19361__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_u64)))
19362svuint64_t svsli_n_u64(svuint64_t, svuint64_t, uint64_t);
19363__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_u16)))
19364svuint16_t svsli_n_u16(svuint16_t, svuint16_t, uint64_t);
19365__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_s8)))
19366svint8_t svsli_n_s8(svint8_t, svint8_t, uint64_t);
19367__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_s32)))
19368svint32_t svsli_n_s32(svint32_t, svint32_t, uint64_t);
19369__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_s64)))
19370svint64_t svsli_n_s64(svint64_t, svint64_t, uint64_t);
19371__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_s16)))
19372svint16_t svsli_n_s16(svint16_t, svint16_t, uint64_t);
19373__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u8_m)))
19374svuint8_t svsqadd_n_u8_m(svbool_t, svuint8_t, int8_t);
19375__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u32_m)))
19376svuint32_t svsqadd_n_u32_m(svbool_t, svuint32_t, int32_t);
19377__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u64_m)))
19378svuint64_t svsqadd_n_u64_m(svbool_t, svuint64_t, int64_t);
19379__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u16_m)))
19380svuint16_t svsqadd_n_u16_m(svbool_t, svuint16_t, int16_t);
19381__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u8_x)))
19382svuint8_t svsqadd_n_u8_x(svbool_t, svuint8_t, int8_t);
19383__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u32_x)))
19384svuint32_t svsqadd_n_u32_x(svbool_t, svuint32_t, int32_t);
19385__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u64_x)))
19386svuint64_t svsqadd_n_u64_x(svbool_t, svuint64_t, int64_t);
19387__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u16_x)))
19388svuint16_t svsqadd_n_u16_x(svbool_t, svuint16_t, int16_t);
19389__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u8_z)))
19390svuint8_t svsqadd_n_u8_z(svbool_t, svuint8_t, int8_t);
19391__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u32_z)))
19392svuint32_t svsqadd_n_u32_z(svbool_t, svuint32_t, int32_t);
19393__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u64_z)))
19394svuint64_t svsqadd_n_u64_z(svbool_t, svuint64_t, int64_t);
19395__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u16_z)))
19396svuint16_t svsqadd_n_u16_z(svbool_t, svuint16_t, int16_t);
19397__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u8_m)))
19398svuint8_t svsqadd_u8_m(svbool_t, svuint8_t, svint8_t);
19399__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u32_m)))
19400svuint32_t svsqadd_u32_m(svbool_t, svuint32_t, svint32_t);
19401__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u64_m)))
19402svuint64_t svsqadd_u64_m(svbool_t, svuint64_t, svint64_t);
19403__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u16_m)))
19404svuint16_t svsqadd_u16_m(svbool_t, svuint16_t, svint16_t);
19405__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u8_x)))
19406svuint8_t svsqadd_u8_x(svbool_t, svuint8_t, svint8_t);
19407__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u32_x)))
19408svuint32_t svsqadd_u32_x(svbool_t, svuint32_t, svint32_t);
19409__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u64_x)))
19410svuint64_t svsqadd_u64_x(svbool_t, svuint64_t, svint64_t);
19411__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u16_x)))
19412svuint16_t svsqadd_u16_x(svbool_t, svuint16_t, svint16_t);
19413__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u8_z)))
19414svuint8_t svsqadd_u8_z(svbool_t, svuint8_t, svint8_t);
19415__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u32_z)))
19416svuint32_t svsqadd_u32_z(svbool_t, svuint32_t, svint32_t);
19417__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u64_z)))
19418svuint64_t svsqadd_u64_z(svbool_t, svuint64_t, svint64_t);
19419__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u16_z)))
19420svuint16_t svsqadd_u16_z(svbool_t, svuint16_t, svint16_t);
19421__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_s8)))
19422svint8_t svsra_n_s8(svint8_t, svint8_t, uint64_t);
19423__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_s32)))
19424svint32_t svsra_n_s32(svint32_t, svint32_t, uint64_t);
19425__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_s64)))
19426svint64_t svsra_n_s64(svint64_t, svint64_t, uint64_t);
19427__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_s16)))
19428svint16_t svsra_n_s16(svint16_t, svint16_t, uint64_t);
19429__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_u8)))
19430svuint8_t svsra_n_u8(svuint8_t, svuint8_t, uint64_t);
19431__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_u32)))
19432svuint32_t svsra_n_u32(svuint32_t, svuint32_t, uint64_t);
19433__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_u64)))
19434svuint64_t svsra_n_u64(svuint64_t, svuint64_t, uint64_t);
19435__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_u16)))
19436svuint16_t svsra_n_u16(svuint16_t, svuint16_t, uint64_t);
19437__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_u8)))
19438svuint8_t svsri_n_u8(svuint8_t, svuint8_t, uint64_t);
19439__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_u32)))
19440svuint32_t svsri_n_u32(svuint32_t, svuint32_t, uint64_t);
19441__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_u64)))
19442svuint64_t svsri_n_u64(svuint64_t, svuint64_t, uint64_t);
19443__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_u16)))
19444svuint16_t svsri_n_u16(svuint16_t, svuint16_t, uint64_t);
19445__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_s8)))
19446svint8_t svsri_n_s8(svint8_t, svint8_t, uint64_t);
19447__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_s32)))
19448svint32_t svsri_n_s32(svint32_t, svint32_t, uint64_t);
19449__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_s64)))
19450svint64_t svsri_n_s64(svint64_t, svint64_t, uint64_t);
19451__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_s16)))
19452svint16_t svsri_n_s16(svint16_t, svint16_t, uint64_t);
19453__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_index_u32)))
19454void svstnt1_scatter_u32base_index_u32(svbool_t, svuint32_t, int64_t, svuint32_t);
19455__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_index_u64)))
19456void svstnt1_scatter_u64base_index_u64(svbool_t, svuint64_t, int64_t, svuint64_t);
19457__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_index_f64)))
19458void svstnt1_scatter_u64base_index_f64(svbool_t, svuint64_t, int64_t, svfloat64_t);
19459__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_index_f32)))
19460void svstnt1_scatter_u32base_index_f32(svbool_t, svuint32_t, int64_t, svfloat32_t);
19461__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_index_s32)))
19462void svstnt1_scatter_u32base_index_s32(svbool_t, svuint32_t, int64_t, svint32_t);
19463__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_index_s64)))
19464void svstnt1_scatter_u64base_index_s64(svbool_t, svuint64_t, int64_t, svint64_t);
19465__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_offset_u32)))
19466void svstnt1_scatter_u32base_offset_u32(svbool_t, svuint32_t, int64_t, svuint32_t);
19467__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_offset_u64)))
19468void svstnt1_scatter_u64base_offset_u64(svbool_t, svuint64_t, int64_t, svuint64_t);
19469__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_offset_f64)))
19470void svstnt1_scatter_u64base_offset_f64(svbool_t, svuint64_t, int64_t, svfloat64_t);
19471__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_offset_f32)))
19472void svstnt1_scatter_u32base_offset_f32(svbool_t, svuint32_t, int64_t, svfloat32_t);
19473__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_offset_s32)))
19474void svstnt1_scatter_u32base_offset_s32(svbool_t, svuint32_t, int64_t, svint32_t);
19475__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_offset_s64)))
19476void svstnt1_scatter_u64base_offset_s64(svbool_t, svuint64_t, int64_t, svint64_t);
19477__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_u32)))
19478void svstnt1_scatter_u32base_u32(svbool_t, svuint32_t, svuint32_t);
19479__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_u64)))
19480void svstnt1_scatter_u64base_u64(svbool_t, svuint64_t, svuint64_t);
19481__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_f64)))
19482void svstnt1_scatter_u64base_f64(svbool_t, svuint64_t, svfloat64_t);
19483__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_f32)))
19484void svstnt1_scatter_u32base_f32(svbool_t, svuint32_t, svfloat32_t);
19485__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_s32)))
19486void svstnt1_scatter_u32base_s32(svbool_t, svuint32_t, svint32_t);
19487__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_s64)))
19488void svstnt1_scatter_u64base_s64(svbool_t, svuint64_t, svint64_t);
19489__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_s64index_u64)))
19490void svstnt1_scatter_s64index_u64(svbool_t, uint64_t *, svint64_t, svuint64_t);
19491__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_s64index_f64)))
19492void svstnt1_scatter_s64index_f64(svbool_t, float64_t *, svint64_t, svfloat64_t);
19493__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_s64index_s64)))
19494void svstnt1_scatter_s64index_s64(svbool_t, int64_t *, svint64_t, svint64_t);
19495__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64index_u64)))
19496void svstnt1_scatter_u64index_u64(svbool_t, uint64_t *, svuint64_t, svuint64_t);
19497__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64index_f64)))
19498void svstnt1_scatter_u64index_f64(svbool_t, float64_t *, svuint64_t, svfloat64_t);
19499__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64index_s64)))
19500void svstnt1_scatter_u64index_s64(svbool_t, int64_t *, svuint64_t, svint64_t);
19501__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32offset_u32)))
19502void svstnt1_scatter_u32offset_u32(svbool_t, uint32_t *, svuint32_t, svuint32_t);
19503__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32offset_f32)))
19504void svstnt1_scatter_u32offset_f32(svbool_t, float32_t *, svuint32_t, svfloat32_t);
19505__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32offset_s32)))
19506void svstnt1_scatter_u32offset_s32(svbool_t, int32_t *, svuint32_t, svint32_t);
19507__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_s64offset_u64)))
19508void svstnt1_scatter_s64offset_u64(svbool_t, uint64_t *, svint64_t, svuint64_t);
19509__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_s64offset_f64)))
19510void svstnt1_scatter_s64offset_f64(svbool_t, float64_t *, svint64_t, svfloat64_t);
19511__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_s64offset_s64)))
19512void svstnt1_scatter_s64offset_s64(svbool_t, int64_t *, svint64_t, svint64_t);
19513__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64offset_u64)))
19514void svstnt1_scatter_u64offset_u64(svbool_t, uint64_t *, svuint64_t, svuint64_t);
19515__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64offset_f64)))
19516void svstnt1_scatter_u64offset_f64(svbool_t, float64_t *, svuint64_t, svfloat64_t);
19517__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64offset_s64)))
19518void svstnt1_scatter_u64offset_s64(svbool_t, int64_t *, svuint64_t, svint64_t);
19519__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u32base_offset_u32)))
19520void svstnt1b_scatter_u32base_offset_u32(svbool_t, svuint32_t, int64_t, svuint32_t);
19521__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u64base_offset_u64)))
19522void svstnt1b_scatter_u64base_offset_u64(svbool_t, svuint64_t, int64_t, svuint64_t);
19523__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u32base_offset_s32)))
19524void svstnt1b_scatter_u32base_offset_s32(svbool_t, svuint32_t, int64_t, svint32_t);
19525__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u64base_offset_s64)))
19526void svstnt1b_scatter_u64base_offset_s64(svbool_t, svuint64_t, int64_t, svint64_t);
19527__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u32base_u32)))
19528void svstnt1b_scatter_u32base_u32(svbool_t, svuint32_t, svuint32_t);
19529__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u64base_u64)))
19530void svstnt1b_scatter_u64base_u64(svbool_t, svuint64_t, svuint64_t);
19531__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u32base_s32)))
19532void svstnt1b_scatter_u32base_s32(svbool_t, svuint32_t, svint32_t);
19533__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u64base_s64)))
19534void svstnt1b_scatter_u64base_s64(svbool_t, svuint64_t, svint64_t);
19535__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u32offset_s32)))
19536void svstnt1b_scatter_u32offset_s32(svbool_t, int8_t *, svuint32_t, svint32_t);
19537__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u32offset_u32)))
19538void svstnt1b_scatter_u32offset_u32(svbool_t, uint8_t *, svuint32_t, svuint32_t);
19539__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_s64offset_s64)))
19540void svstnt1b_scatter_s64offset_s64(svbool_t, int8_t *, svint64_t, svint64_t);
19541__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_s64offset_u64)))
19542void svstnt1b_scatter_s64offset_u64(svbool_t, uint8_t *, svint64_t, svuint64_t);
19543__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u64offset_s64)))
19544void svstnt1b_scatter_u64offset_s64(svbool_t, int8_t *, svuint64_t, svint64_t);
19545__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u64offset_u64)))
19546void svstnt1b_scatter_u64offset_u64(svbool_t, uint8_t *, svuint64_t, svuint64_t);
19547__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32base_index_u32)))
19548void svstnt1h_scatter_u32base_index_u32(svbool_t, svuint32_t, int64_t, svuint32_t);
19549__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64base_index_u64)))
19550void svstnt1h_scatter_u64base_index_u64(svbool_t, svuint64_t, int64_t, svuint64_t);
19551__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32base_index_s32)))
19552void svstnt1h_scatter_u32base_index_s32(svbool_t, svuint32_t, int64_t, svint32_t);
19553__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64base_index_s64)))
19554void svstnt1h_scatter_u64base_index_s64(svbool_t, svuint64_t, int64_t, svint64_t);
19555__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32base_offset_u32)))
19556void svstnt1h_scatter_u32base_offset_u32(svbool_t, svuint32_t, int64_t, svuint32_t);
19557__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64base_offset_u64)))
19558void svstnt1h_scatter_u64base_offset_u64(svbool_t, svuint64_t, int64_t, svuint64_t);
19559__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32base_offset_s32)))
19560void svstnt1h_scatter_u32base_offset_s32(svbool_t, svuint32_t, int64_t, svint32_t);
19561__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64base_offset_s64)))
19562void svstnt1h_scatter_u64base_offset_s64(svbool_t, svuint64_t, int64_t, svint64_t);
19563__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32base_u32)))
19564void svstnt1h_scatter_u32base_u32(svbool_t, svuint32_t, svuint32_t);
19565__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64base_u64)))
19566void svstnt1h_scatter_u64base_u64(svbool_t, svuint64_t, svuint64_t);
19567__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32base_s32)))
19568void svstnt1h_scatter_u32base_s32(svbool_t, svuint32_t, svint32_t);
19569__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64base_s64)))
19570void svstnt1h_scatter_u64base_s64(svbool_t, svuint64_t, svint64_t);
19571__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_s64index_s64)))
19572void svstnt1h_scatter_s64index_s64(svbool_t, int16_t *, svint64_t, svint64_t);
19573__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_s64index_u64)))
19574void svstnt1h_scatter_s64index_u64(svbool_t, uint16_t *, svint64_t, svuint64_t);
19575__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64index_s64)))
19576void svstnt1h_scatter_u64index_s64(svbool_t, int16_t *, svuint64_t, svint64_t);
19577__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64index_u64)))
19578void svstnt1h_scatter_u64index_u64(svbool_t, uint16_t *, svuint64_t, svuint64_t);
19579__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32offset_s32)))
19580void svstnt1h_scatter_u32offset_s32(svbool_t, int16_t *, svuint32_t, svint32_t);
19581__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32offset_u32)))
19582void svstnt1h_scatter_u32offset_u32(svbool_t, uint16_t *, svuint32_t, svuint32_t);
19583__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_s64offset_s64)))
19584void svstnt1h_scatter_s64offset_s64(svbool_t, int16_t *, svint64_t, svint64_t);
19585__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_s64offset_u64)))
19586void svstnt1h_scatter_s64offset_u64(svbool_t, uint16_t *, svint64_t, svuint64_t);
19587__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64offset_s64)))
19588void svstnt1h_scatter_u64offset_s64(svbool_t, int16_t *, svuint64_t, svint64_t);
19589__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64offset_u64)))
19590void svstnt1h_scatter_u64offset_u64(svbool_t, uint16_t *, svuint64_t, svuint64_t);
19591__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64base_index_u64)))
19592void svstnt1w_scatter_u64base_index_u64(svbool_t, svuint64_t, int64_t, svuint64_t);
19593__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64base_index_s64)))
19594void svstnt1w_scatter_u64base_index_s64(svbool_t, svuint64_t, int64_t, svint64_t);
19595__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64base_offset_u64)))
19596void svstnt1w_scatter_u64base_offset_u64(svbool_t, svuint64_t, int64_t, svuint64_t);
19597__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64base_offset_s64)))
19598void svstnt1w_scatter_u64base_offset_s64(svbool_t, svuint64_t, int64_t, svint64_t);
19599__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64base_u64)))
19600void svstnt1w_scatter_u64base_u64(svbool_t, svuint64_t, svuint64_t);
19601__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64base_s64)))
19602void svstnt1w_scatter_u64base_s64(svbool_t, svuint64_t, svint64_t);
19603__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_s64index_s64)))
19604void svstnt1w_scatter_s64index_s64(svbool_t, int32_t *, svint64_t, svint64_t);
19605__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_s64index_u64)))
19606void svstnt1w_scatter_s64index_u64(svbool_t, uint32_t *, svint64_t, svuint64_t);
19607__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64index_s64)))
19608void svstnt1w_scatter_u64index_s64(svbool_t, int32_t *, svuint64_t, svint64_t);
19609__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64index_u64)))
19610void svstnt1w_scatter_u64index_u64(svbool_t, uint32_t *, svuint64_t, svuint64_t);
19611__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_s64offset_s64)))
19612void svstnt1w_scatter_s64offset_s64(svbool_t, int32_t *, svint64_t, svint64_t);
19613__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_s64offset_u64)))
19614void svstnt1w_scatter_s64offset_u64(svbool_t, uint32_t *, svint64_t, svuint64_t);
19615__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64offset_s64)))
19616void svstnt1w_scatter_u64offset_s64(svbool_t, int32_t *, svuint64_t, svint64_t);
19617__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64offset_u64)))
19618void svstnt1w_scatter_u64offset_u64(svbool_t, uint32_t *, svuint64_t, svuint64_t);
19619__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_n_u32)))
19620svuint16_t svsubhnb_n_u32(svuint32_t, uint32_t);
19621__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_n_u64)))
19622svuint32_t svsubhnb_n_u64(svuint64_t, uint64_t);
19623__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_n_u16)))
19624svuint8_t svsubhnb_n_u16(svuint16_t, uint16_t);
19625__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_n_s32)))
19626svint16_t svsubhnb_n_s32(svint32_t, int32_t);
19627__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_n_s64)))
19628svint32_t svsubhnb_n_s64(svint64_t, int64_t);
19629__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_n_s16)))
19630svint8_t svsubhnb_n_s16(svint16_t, int16_t);
19631__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_u32)))
19632svuint16_t svsubhnb_u32(svuint32_t, svuint32_t);
19633__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_u64)))
19634svuint32_t svsubhnb_u64(svuint64_t, svuint64_t);
19635__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_u16)))
19636svuint8_t svsubhnb_u16(svuint16_t, svuint16_t);
19637__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_s32)))
19638svint16_t svsubhnb_s32(svint32_t, svint32_t);
19639__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_s64)))
19640svint32_t svsubhnb_s64(svint64_t, svint64_t);
19641__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_s16)))
19642svint8_t svsubhnb_s16(svint16_t, svint16_t);
19643__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_n_u32)))
19644svuint16_t svsubhnt_n_u32(svuint16_t, svuint32_t, uint32_t);
19645__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_n_u64)))
19646svuint32_t svsubhnt_n_u64(svuint32_t, svuint64_t, uint64_t);
19647__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_n_u16)))
19648svuint8_t svsubhnt_n_u16(svuint8_t, svuint16_t, uint16_t);
19649__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_n_s32)))
19650svint16_t svsubhnt_n_s32(svint16_t, svint32_t, int32_t);
19651__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_n_s64)))
19652svint32_t svsubhnt_n_s64(svint32_t, svint64_t, int64_t);
19653__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_n_s16)))
19654svint8_t svsubhnt_n_s16(svint8_t, svint16_t, int16_t);
19655__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_u32)))
19656svuint16_t svsubhnt_u32(svuint16_t, svuint32_t, svuint32_t);
19657__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_u64)))
19658svuint32_t svsubhnt_u64(svuint32_t, svuint64_t, svuint64_t);
19659__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_u16)))
19660svuint8_t svsubhnt_u16(svuint8_t, svuint16_t, svuint16_t);
19661__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_s32)))
19662svint16_t svsubhnt_s32(svint16_t, svint32_t, svint32_t);
19663__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_s64)))
19664svint32_t svsubhnt_s64(svint32_t, svint64_t, svint64_t);
19665__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_s16)))
19666svint8_t svsubhnt_s16(svint8_t, svint16_t, svint16_t);
19667__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_n_s32)))
19668svint32_t svsublb_n_s32(svint16_t, int16_t);
19669__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_n_s64)))
19670svint64_t svsublb_n_s64(svint32_t, int32_t);
19671__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_n_s16)))
19672svint16_t svsublb_n_s16(svint8_t, int8_t);
19673__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_n_u32)))
19674svuint32_t svsublb_n_u32(svuint16_t, uint16_t);
19675__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_n_u64)))
19676svuint64_t svsublb_n_u64(svuint32_t, uint32_t);
19677__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_n_u16)))
19678svuint16_t svsublb_n_u16(svuint8_t, uint8_t);
19679__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_s32)))
19680svint32_t svsublb_s32(svint16_t, svint16_t);
19681__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_s64)))
19682svint64_t svsublb_s64(svint32_t, svint32_t);
19683__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_s16)))
19684svint16_t svsublb_s16(svint8_t, svint8_t);
19685__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_u32)))
19686svuint32_t svsublb_u32(svuint16_t, svuint16_t);
19687__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_u64)))
19688svuint64_t svsublb_u64(svuint32_t, svuint32_t);
19689__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_u16)))
19690svuint16_t svsublb_u16(svuint8_t, svuint8_t);
19691__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublbt_n_s32)))
19692svint32_t svsublbt_n_s32(svint16_t, int16_t);
19693__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublbt_n_s64)))
19694svint64_t svsublbt_n_s64(svint32_t, int32_t);
19695__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublbt_n_s16)))
19696svint16_t svsublbt_n_s16(svint8_t, int8_t);
19697__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublbt_s32)))
19698svint32_t svsublbt_s32(svint16_t, svint16_t);
19699__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublbt_s64)))
19700svint64_t svsublbt_s64(svint32_t, svint32_t);
19701__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublbt_s16)))
19702svint16_t svsublbt_s16(svint8_t, svint8_t);
19703__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_n_s32)))
19704svint32_t svsublt_n_s32(svint16_t, int16_t);
19705__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_n_s64)))
19706svint64_t svsublt_n_s64(svint32_t, int32_t);
19707__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_n_s16)))
19708svint16_t svsublt_n_s16(svint8_t, int8_t);
19709__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_n_u32)))
19710svuint32_t svsublt_n_u32(svuint16_t, uint16_t);
19711__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_n_u64)))
19712svuint64_t svsublt_n_u64(svuint32_t, uint32_t);
19713__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_n_u16)))
19714svuint16_t svsublt_n_u16(svuint8_t, uint8_t);
19715__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_s32)))
19716svint32_t svsublt_s32(svint16_t, svint16_t);
19717__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_s64)))
19718svint64_t svsublt_s64(svint32_t, svint32_t);
19719__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_s16)))
19720svint16_t svsublt_s16(svint8_t, svint8_t);
19721__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_u32)))
19722svuint32_t svsublt_u32(svuint16_t, svuint16_t);
19723__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_u64)))
19724svuint64_t svsublt_u64(svuint32_t, svuint32_t);
19725__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_u16)))
19726svuint16_t svsublt_u16(svuint8_t, svuint8_t);
19727__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubltb_n_s32)))
19728svint32_t svsubltb_n_s32(svint16_t, int16_t);
19729__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubltb_n_s64)))
19730svint64_t svsubltb_n_s64(svint32_t, int32_t);
19731__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubltb_n_s16)))
19732svint16_t svsubltb_n_s16(svint8_t, int8_t);
19733__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubltb_s32)))
19734svint32_t svsubltb_s32(svint16_t, svint16_t);
19735__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubltb_s64)))
19736svint64_t svsubltb_s64(svint32_t, svint32_t);
19737__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubltb_s16)))
19738svint16_t svsubltb_s16(svint8_t, svint8_t);
19739__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_n_s32)))
19740svint32_t svsubwb_n_s32(svint32_t, int16_t);
19741__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_n_s64)))
19742svint64_t svsubwb_n_s64(svint64_t, int32_t);
19743__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_n_s16)))
19744svint16_t svsubwb_n_s16(svint16_t, int8_t);
19745__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_n_u32)))
19746svuint32_t svsubwb_n_u32(svuint32_t, uint16_t);
19747__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_n_u64)))
19748svuint64_t svsubwb_n_u64(svuint64_t, uint32_t);
19749__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_n_u16)))
19750svuint16_t svsubwb_n_u16(svuint16_t, uint8_t);
19751__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_s32)))
19752svint32_t svsubwb_s32(svint32_t, svint16_t);
19753__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_s64)))
19754svint64_t svsubwb_s64(svint64_t, svint32_t);
19755__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_s16)))
19756svint16_t svsubwb_s16(svint16_t, svint8_t);
19757__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_u32)))
19758svuint32_t svsubwb_u32(svuint32_t, svuint16_t);
19759__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_u64)))
19760svuint64_t svsubwb_u64(svuint64_t, svuint32_t);
19761__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_u16)))
19762svuint16_t svsubwb_u16(svuint16_t, svuint8_t);
19763__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_n_s32)))
19764svint32_t svsubwt_n_s32(svint32_t, int16_t);
19765__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_n_s64)))
19766svint64_t svsubwt_n_s64(svint64_t, int32_t);
19767__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_n_s16)))
19768svint16_t svsubwt_n_s16(svint16_t, int8_t);
19769__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_n_u32)))
19770svuint32_t svsubwt_n_u32(svuint32_t, uint16_t);
19771__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_n_u64)))
19772svuint64_t svsubwt_n_u64(svuint64_t, uint32_t);
19773__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_n_u16)))
19774svuint16_t svsubwt_n_u16(svuint16_t, uint8_t);
19775__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_s32)))
19776svint32_t svsubwt_s32(svint32_t, svint16_t);
19777__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_s64)))
19778svint64_t svsubwt_s64(svint64_t, svint32_t);
19779__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_s16)))
19780svint16_t svsubwt_s16(svint16_t, svint8_t);
19781__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_u32)))
19782svuint32_t svsubwt_u32(svuint32_t, svuint16_t);
19783__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_u64)))
19784svuint64_t svsubwt_u64(svuint64_t, svuint32_t);
19785__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_u16)))
19786svuint16_t svsubwt_u16(svuint16_t, svuint8_t);
19787__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_u8)))
19788svuint8_t svtbl2_u8(svuint8x2_t, svuint8_t);
19789__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_u32)))
19790svuint32_t svtbl2_u32(svuint32x2_t, svuint32_t);
19791__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_u64)))
19792svuint64_t svtbl2_u64(svuint64x2_t, svuint64_t);
19793__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_u16)))
19794svuint16_t svtbl2_u16(svuint16x2_t, svuint16_t);
19795__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_s8)))
19796svint8_t svtbl2_s8(svint8x2_t, svuint8_t);
19797__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_f64)))
19798svfloat64_t svtbl2_f64(svfloat64x2_t, svuint64_t);
19799__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_f32)))
19800svfloat32_t svtbl2_f32(svfloat32x2_t, svuint32_t);
19801__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_f16)))
19802svfloat16_t svtbl2_f16(svfloat16x2_t, svuint16_t);
19803__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_s32)))
19804svint32_t svtbl2_s32(svint32x2_t, svuint32_t);
19805__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_s64)))
19806svint64_t svtbl2_s64(svint64x2_t, svuint64_t);
19807__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_s16)))
19808svint16_t svtbl2_s16(svint16x2_t, svuint16_t);
19809__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_u8)))
19810svuint8_t svtbx_u8(svuint8_t, svuint8_t, svuint8_t);
19811__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_u32)))
19812svuint32_t svtbx_u32(svuint32_t, svuint32_t, svuint32_t);
19813__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_u64)))
19814svuint64_t svtbx_u64(svuint64_t, svuint64_t, svuint64_t);
19815__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_u16)))
19816svuint16_t svtbx_u16(svuint16_t, svuint16_t, svuint16_t);
19817__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_s8)))
19818svint8_t svtbx_s8(svint8_t, svint8_t, svuint8_t);
19819__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_f64)))
19820svfloat64_t svtbx_f64(svfloat64_t, svfloat64_t, svuint64_t);
19821__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_f32)))
19822svfloat32_t svtbx_f32(svfloat32_t, svfloat32_t, svuint32_t);
19823__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_f16)))
19824svfloat16_t svtbx_f16(svfloat16_t, svfloat16_t, svuint16_t);
19825__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_s32)))
19826svint32_t svtbx_s32(svint32_t, svint32_t, svuint32_t);
19827__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_s64)))
19828svint64_t svtbx_s64(svint64_t, svint64_t, svuint64_t);
19829__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_s16)))
19830svint16_t svtbx_s16(svint16_t, svint16_t, svuint16_t);
19831__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s8_m)))
19832svint8_t svuqadd_n_s8_m(svbool_t, svint8_t, uint8_t);
19833__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s32_m)))
19834svint32_t svuqadd_n_s32_m(svbool_t, svint32_t, uint32_t);
19835__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s64_m)))
19836svint64_t svuqadd_n_s64_m(svbool_t, svint64_t, uint64_t);
19837__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s16_m)))
19838svint16_t svuqadd_n_s16_m(svbool_t, svint16_t, uint16_t);
19839__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s8_x)))
19840svint8_t svuqadd_n_s8_x(svbool_t, svint8_t, uint8_t);
19841__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s32_x)))
19842svint32_t svuqadd_n_s32_x(svbool_t, svint32_t, uint32_t);
19843__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s64_x)))
19844svint64_t svuqadd_n_s64_x(svbool_t, svint64_t, uint64_t);
19845__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s16_x)))
19846svint16_t svuqadd_n_s16_x(svbool_t, svint16_t, uint16_t);
19847__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s8_z)))
19848svint8_t svuqadd_n_s8_z(svbool_t, svint8_t, uint8_t);
19849__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s32_z)))
19850svint32_t svuqadd_n_s32_z(svbool_t, svint32_t, uint32_t);
19851__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s64_z)))
19852svint64_t svuqadd_n_s64_z(svbool_t, svint64_t, uint64_t);
19853__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s16_z)))
19854svint16_t svuqadd_n_s16_z(svbool_t, svint16_t, uint16_t);
19855__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s8_m)))
19856svint8_t svuqadd_s8_m(svbool_t, svint8_t, svuint8_t);
19857__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s32_m)))
19858svint32_t svuqadd_s32_m(svbool_t, svint32_t, svuint32_t);
19859__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s64_m)))
19860svint64_t svuqadd_s64_m(svbool_t, svint64_t, svuint64_t);
19861__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s16_m)))
19862svint16_t svuqadd_s16_m(svbool_t, svint16_t, svuint16_t);
19863__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s8_x)))
19864svint8_t svuqadd_s8_x(svbool_t, svint8_t, svuint8_t);
19865__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s32_x)))
19866svint32_t svuqadd_s32_x(svbool_t, svint32_t, svuint32_t);
19867__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s64_x)))
19868svint64_t svuqadd_s64_x(svbool_t, svint64_t, svuint64_t);
19869__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s16_x)))
19870svint16_t svuqadd_s16_x(svbool_t, svint16_t, svuint16_t);
19871__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s8_z)))
19872svint8_t svuqadd_s8_z(svbool_t, svint8_t, svuint8_t);
19873__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s32_z)))
19874svint32_t svuqadd_s32_z(svbool_t, svint32_t, svuint32_t);
19875__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s64_z)))
19876svint64_t svuqadd_s64_z(svbool_t, svint64_t, svuint64_t);
19877__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s16_z)))
19878svint16_t svuqadd_s16_z(svbool_t, svint16_t, svuint16_t);
19879__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b8_s32)))
19880svbool_t svwhilege_b8_s32(int32_t, int32_t);
19881__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b32_s32)))
19882svbool_t svwhilege_b32_s32(int32_t, int32_t);
19883__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b64_s32)))
19884svbool_t svwhilege_b64_s32(int32_t, int32_t);
19885__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b16_s32)))
19886svbool_t svwhilege_b16_s32(int32_t, int32_t);
19887__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b8_s64)))
19888svbool_t svwhilege_b8_s64(int64_t, int64_t);
19889__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b32_s64)))
19890svbool_t svwhilege_b32_s64(int64_t, int64_t);
19891__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b64_s64)))
19892svbool_t svwhilege_b64_s64(int64_t, int64_t);
19893__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b16_s64)))
19894svbool_t svwhilege_b16_s64(int64_t, int64_t);
19895__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b8_u32)))
19896svbool_t svwhilege_b8_u32(uint32_t, uint32_t);
19897__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b32_u32)))
19898svbool_t svwhilege_b32_u32(uint32_t, uint32_t);
19899__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b64_u32)))
19900svbool_t svwhilege_b64_u32(uint32_t, uint32_t);
19901__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b16_u32)))
19902svbool_t svwhilege_b16_u32(uint32_t, uint32_t);
19903__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b8_u64)))
19904svbool_t svwhilege_b8_u64(uint64_t, uint64_t);
19905__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b32_u64)))
19906svbool_t svwhilege_b32_u64(uint64_t, uint64_t);
19907__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b64_u64)))
19908svbool_t svwhilege_b64_u64(uint64_t, uint64_t);
19909__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b16_u64)))
19910svbool_t svwhilege_b16_u64(uint64_t, uint64_t);
19911__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b8_s32)))
19912svbool_t svwhilegt_b8_s32(int32_t, int32_t);
19913__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b32_s32)))
19914svbool_t svwhilegt_b32_s32(int32_t, int32_t);
19915__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b64_s32)))
19916svbool_t svwhilegt_b64_s32(int32_t, int32_t);
19917__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b16_s32)))
19918svbool_t svwhilegt_b16_s32(int32_t, int32_t);
19919__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b8_s64)))
19920svbool_t svwhilegt_b8_s64(int64_t, int64_t);
19921__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b32_s64)))
19922svbool_t svwhilegt_b32_s64(int64_t, int64_t);
19923__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b64_s64)))
19924svbool_t svwhilegt_b64_s64(int64_t, int64_t);
19925__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b16_s64)))
19926svbool_t svwhilegt_b16_s64(int64_t, int64_t);
19927__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b8_u32)))
19928svbool_t svwhilegt_b8_u32(uint32_t, uint32_t);
19929__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b32_u32)))
19930svbool_t svwhilegt_b32_u32(uint32_t, uint32_t);
19931__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b64_u32)))
19932svbool_t svwhilegt_b64_u32(uint32_t, uint32_t);
19933__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b16_u32)))
19934svbool_t svwhilegt_b16_u32(uint32_t, uint32_t);
19935__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b8_u64)))
19936svbool_t svwhilegt_b8_u64(uint64_t, uint64_t);
19937__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b32_u64)))
19938svbool_t svwhilegt_b32_u64(uint64_t, uint64_t);
19939__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b64_u64)))
19940svbool_t svwhilegt_b64_u64(uint64_t, uint64_t);
19941__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b16_u64)))
19942svbool_t svwhilegt_b16_u64(uint64_t, uint64_t);
19943__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_u8)))
19944svbool_t svwhilerw_u8(uint8_t const *, uint8_t const *);
19945__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_s8)))
19946svbool_t svwhilerw_s8(int8_t const *, int8_t const *);
19947__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_u64)))
19948svbool_t svwhilerw_u64(uint64_t const *, uint64_t const *);
19949__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_f64)))
19950svbool_t svwhilerw_f64(float64_t const *, float64_t const *);
19951__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_s64)))
19952svbool_t svwhilerw_s64(int64_t const *, int64_t const *);
19953__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_u16)))
19954svbool_t svwhilerw_u16(uint16_t const *, uint16_t const *);
19955__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_f16)))
19956svbool_t svwhilerw_f16(float16_t const *, float16_t const *);
19957__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_s16)))
19958svbool_t svwhilerw_s16(int16_t const *, int16_t const *);
19959__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_u32)))
19960svbool_t svwhilerw_u32(uint32_t const *, uint32_t const *);
19961__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_f32)))
19962svbool_t svwhilerw_f32(float32_t const *, float32_t const *);
19963__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_s32)))
19964svbool_t svwhilerw_s32(int32_t const *, int32_t const *);
19965__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_u8)))
19966svbool_t svwhilewr_u8(uint8_t const *, uint8_t const *);
19967__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_s8)))
19968svbool_t svwhilewr_s8(int8_t const *, int8_t const *);
19969__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_u64)))
19970svbool_t svwhilewr_u64(uint64_t const *, uint64_t const *);
19971__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_f64)))
19972svbool_t svwhilewr_f64(float64_t const *, float64_t const *);
19973__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_s64)))
19974svbool_t svwhilewr_s64(int64_t const *, int64_t const *);
19975__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_u16)))
19976svbool_t svwhilewr_u16(uint16_t const *, uint16_t const *);
19977__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_f16)))
19978svbool_t svwhilewr_f16(float16_t const *, float16_t const *);
19979__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_s16)))
19980svbool_t svwhilewr_s16(int16_t const *, int16_t const *);
19981__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_u32)))
19982svbool_t svwhilewr_u32(uint32_t const *, uint32_t const *);
19983__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_f32)))
19984svbool_t svwhilewr_f32(float32_t const *, float32_t const *);
19985__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_s32)))
19986svbool_t svwhilewr_s32(int32_t const *, int32_t const *);
19987__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_u8)))
19988svuint8_t svxar_n_u8(svuint8_t, svuint8_t, uint64_t);
19989__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_u32)))
19990svuint32_t svxar_n_u32(svuint32_t, svuint32_t, uint64_t);
19991__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_u64)))
19992svuint64_t svxar_n_u64(svuint64_t, svuint64_t, uint64_t);
19993__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_u16)))
19994svuint16_t svxar_n_u16(svuint16_t, svuint16_t, uint64_t);
19995__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_s8)))
19996svint8_t svxar_n_s8(svint8_t, svint8_t, uint64_t);
19997__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_s32)))
19998svint32_t svxar_n_s32(svint32_t, svint32_t, uint64_t);
19999__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_s64)))
20000svint64_t svxar_n_s64(svint64_t, svint64_t, uint64_t);
20001__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_s16)))
20002svint16_t svxar_n_s16(svint16_t, svint16_t, uint64_t);
20003__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_s8)))
20004svint8_t svaba(svint8_t, svint8_t, int8_t);
20005__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_s32)))
20006svint32_t svaba(svint32_t, svint32_t, int32_t);
20007__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_s64)))
20008svint64_t svaba(svint64_t, svint64_t, int64_t);
20009__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_s16)))
20010svint16_t svaba(svint16_t, svint16_t, int16_t);
20011__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_u8)))
20012svuint8_t svaba(svuint8_t, svuint8_t, uint8_t);
20013__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_u32)))
20014svuint32_t svaba(svuint32_t, svuint32_t, uint32_t);
20015__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_u64)))
20016svuint64_t svaba(svuint64_t, svuint64_t, uint64_t);
20017__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_n_u16)))
20018svuint16_t svaba(svuint16_t, svuint16_t, uint16_t);
20019__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_s8)))
20020svint8_t svaba(svint8_t, svint8_t, svint8_t);
20021__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_s32)))
20022svint32_t svaba(svint32_t, svint32_t, svint32_t);
20023__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_s64)))
20024svint64_t svaba(svint64_t, svint64_t, svint64_t);
20025__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_s16)))
20026svint16_t svaba(svint16_t, svint16_t, svint16_t);
20027__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_u8)))
20028svuint8_t svaba(svuint8_t, svuint8_t, svuint8_t);
20029__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_u32)))
20030svuint32_t svaba(svuint32_t, svuint32_t, svuint32_t);
20031__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_u64)))
20032svuint64_t svaba(svuint64_t, svuint64_t, svuint64_t);
20033__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaba_u16)))
20034svuint16_t svaba(svuint16_t, svuint16_t, svuint16_t);
20035__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_n_s32)))
20036svint32_t svabalb(svint32_t, svint16_t, int16_t);
20037__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_n_s64)))
20038svint64_t svabalb(svint64_t, svint32_t, int32_t);
20039__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_n_s16)))
20040svint16_t svabalb(svint16_t, svint8_t, int8_t);
20041__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_n_u32)))
20042svuint32_t svabalb(svuint32_t, svuint16_t, uint16_t);
20043__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_n_u64)))
20044svuint64_t svabalb(svuint64_t, svuint32_t, uint32_t);
20045__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_n_u16)))
20046svuint16_t svabalb(svuint16_t, svuint8_t, uint8_t);
20047__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_s32)))
20048svint32_t svabalb(svint32_t, svint16_t, svint16_t);
20049__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_s64)))
20050svint64_t svabalb(svint64_t, svint32_t, svint32_t);
20051__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_s16)))
20052svint16_t svabalb(svint16_t, svint8_t, svint8_t);
20053__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_u32)))
20054svuint32_t svabalb(svuint32_t, svuint16_t, svuint16_t);
20055__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_u64)))
20056svuint64_t svabalb(svuint64_t, svuint32_t, svuint32_t);
20057__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalb_u16)))
20058svuint16_t svabalb(svuint16_t, svuint8_t, svuint8_t);
20059__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_n_s32)))
20060svint32_t svabalt(svint32_t, svint16_t, int16_t);
20061__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_n_s64)))
20062svint64_t svabalt(svint64_t, svint32_t, int32_t);
20063__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_n_s16)))
20064svint16_t svabalt(svint16_t, svint8_t, int8_t);
20065__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_n_u32)))
20066svuint32_t svabalt(svuint32_t, svuint16_t, uint16_t);
20067__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_n_u64)))
20068svuint64_t svabalt(svuint64_t, svuint32_t, uint32_t);
20069__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_n_u16)))
20070svuint16_t svabalt(svuint16_t, svuint8_t, uint8_t);
20071__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_s32)))
20072svint32_t svabalt(svint32_t, svint16_t, svint16_t);
20073__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_s64)))
20074svint64_t svabalt(svint64_t, svint32_t, svint32_t);
20075__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_s16)))
20076svint16_t svabalt(svint16_t, svint8_t, svint8_t);
20077__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_u32)))
20078svuint32_t svabalt(svuint32_t, svuint16_t, svuint16_t);
20079__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_u64)))
20080svuint64_t svabalt(svuint64_t, svuint32_t, svuint32_t);
20081__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabalt_u16)))
20082svuint16_t svabalt(svuint16_t, svuint8_t, svuint8_t);
20083__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_n_s32)))
20084svint32_t svabdlb(svint16_t, int16_t);
20085__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_n_s64)))
20086svint64_t svabdlb(svint32_t, int32_t);
20087__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_n_s16)))
20088svint16_t svabdlb(svint8_t, int8_t);
20089__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_n_u32)))
20090svuint32_t svabdlb(svuint16_t, uint16_t);
20091__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_n_u64)))
20092svuint64_t svabdlb(svuint32_t, uint32_t);
20093__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_n_u16)))
20094svuint16_t svabdlb(svuint8_t, uint8_t);
20095__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_s32)))
20096svint32_t svabdlb(svint16_t, svint16_t);
20097__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_s64)))
20098svint64_t svabdlb(svint32_t, svint32_t);
20099__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_s16)))
20100svint16_t svabdlb(svint8_t, svint8_t);
20101__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_u32)))
20102svuint32_t svabdlb(svuint16_t, svuint16_t);
20103__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_u64)))
20104svuint64_t svabdlb(svuint32_t, svuint32_t);
20105__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlb_u16)))
20106svuint16_t svabdlb(svuint8_t, svuint8_t);
20107__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_n_s32)))
20108svint32_t svabdlt(svint16_t, int16_t);
20109__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_n_s64)))
20110svint64_t svabdlt(svint32_t, int32_t);
20111__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_n_s16)))
20112svint16_t svabdlt(svint8_t, int8_t);
20113__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_n_u32)))
20114svuint32_t svabdlt(svuint16_t, uint16_t);
20115__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_n_u64)))
20116svuint64_t svabdlt(svuint32_t, uint32_t);
20117__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_n_u16)))
20118svuint16_t svabdlt(svuint8_t, uint8_t);
20119__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_s32)))
20120svint32_t svabdlt(svint16_t, svint16_t);
20121__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_s64)))
20122svint64_t svabdlt(svint32_t, svint32_t);
20123__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_s16)))
20124svint16_t svabdlt(svint8_t, svint8_t);
20125__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_u32)))
20126svuint32_t svabdlt(svuint16_t, svuint16_t);
20127__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_u64)))
20128svuint64_t svabdlt(svuint32_t, svuint32_t);
20129__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svabdlt_u16)))
20130svuint16_t svabdlt(svuint8_t, svuint8_t);
20131__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s32_m)))
20132svint32_t svadalp_m(svbool_t, svint32_t, svint16_t);
20133__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s64_m)))
20134svint64_t svadalp_m(svbool_t, svint64_t, svint32_t);
20135__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s16_m)))
20136svint16_t svadalp_m(svbool_t, svint16_t, svint8_t);
20137__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s32_x)))
20138svint32_t svadalp_x(svbool_t, svint32_t, svint16_t);
20139__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s64_x)))
20140svint64_t svadalp_x(svbool_t, svint64_t, svint32_t);
20141__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s16_x)))
20142svint16_t svadalp_x(svbool_t, svint16_t, svint8_t);
20143__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s32_z)))
20144svint32_t svadalp_z(svbool_t, svint32_t, svint16_t);
20145__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s64_z)))
20146svint64_t svadalp_z(svbool_t, svint64_t, svint32_t);
20147__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_s16_z)))
20148svint16_t svadalp_z(svbool_t, svint16_t, svint8_t);
20149__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u32_m)))
20150svuint32_t svadalp_m(svbool_t, svuint32_t, svuint16_t);
20151__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u64_m)))
20152svuint64_t svadalp_m(svbool_t, svuint64_t, svuint32_t);
20153__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u16_m)))
20154svuint16_t svadalp_m(svbool_t, svuint16_t, svuint8_t);
20155__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u32_x)))
20156svuint32_t svadalp_x(svbool_t, svuint32_t, svuint16_t);
20157__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u64_x)))
20158svuint64_t svadalp_x(svbool_t, svuint64_t, svuint32_t);
20159__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u16_x)))
20160svuint16_t svadalp_x(svbool_t, svuint16_t, svuint8_t);
20161__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u32_z)))
20162svuint32_t svadalp_z(svbool_t, svuint32_t, svuint16_t);
20163__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u64_z)))
20164svuint64_t svadalp_z(svbool_t, svuint64_t, svuint32_t);
20165__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadalp_u16_z)))
20166svuint16_t svadalp_z(svbool_t, svuint16_t, svuint8_t);
20167__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclb_n_u32)))
20168svuint32_t svadclb(svuint32_t, svuint32_t, uint32_t);
20169__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclb_n_u64)))
20170svuint64_t svadclb(svuint64_t, svuint64_t, uint64_t);
20171__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclb_u32)))
20172svuint32_t svadclb(svuint32_t, svuint32_t, svuint32_t);
20173__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclb_u64)))
20174svuint64_t svadclb(svuint64_t, svuint64_t, svuint64_t);
20175__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclt_n_u32)))
20176svuint32_t svadclt(svuint32_t, svuint32_t, uint32_t);
20177__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclt_n_u64)))
20178svuint64_t svadclt(svuint64_t, svuint64_t, uint64_t);
20179__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclt_u32)))
20180svuint32_t svadclt(svuint32_t, svuint32_t, svuint32_t);
20181__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svadclt_u64)))
20182svuint64_t svadclt(svuint64_t, svuint64_t, svuint64_t);
20183__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_n_u32)))
20184svuint16_t svaddhnb(svuint32_t, uint32_t);
20185__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_n_u64)))
20186svuint32_t svaddhnb(svuint64_t, uint64_t);
20187__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_n_u16)))
20188svuint8_t svaddhnb(svuint16_t, uint16_t);
20189__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_n_s32)))
20190svint16_t svaddhnb(svint32_t, int32_t);
20191__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_n_s64)))
20192svint32_t svaddhnb(svint64_t, int64_t);
20193__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_n_s16)))
20194svint8_t svaddhnb(svint16_t, int16_t);
20195__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_u32)))
20196svuint16_t svaddhnb(svuint32_t, svuint32_t);
20197__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_u64)))
20198svuint32_t svaddhnb(svuint64_t, svuint64_t);
20199__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_u16)))
20200svuint8_t svaddhnb(svuint16_t, svuint16_t);
20201__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_s32)))
20202svint16_t svaddhnb(svint32_t, svint32_t);
20203__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_s64)))
20204svint32_t svaddhnb(svint64_t, svint64_t);
20205__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnb_s16)))
20206svint8_t svaddhnb(svint16_t, svint16_t);
20207__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_n_u32)))
20208svuint16_t svaddhnt(svuint16_t, svuint32_t, uint32_t);
20209__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_n_u64)))
20210svuint32_t svaddhnt(svuint32_t, svuint64_t, uint64_t);
20211__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_n_u16)))
20212svuint8_t svaddhnt(svuint8_t, svuint16_t, uint16_t);
20213__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_n_s32)))
20214svint16_t svaddhnt(svint16_t, svint32_t, int32_t);
20215__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_n_s64)))
20216svint32_t svaddhnt(svint32_t, svint64_t, int64_t);
20217__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_n_s16)))
20218svint8_t svaddhnt(svint8_t, svint16_t, int16_t);
20219__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_u32)))
20220svuint16_t svaddhnt(svuint16_t, svuint32_t, svuint32_t);
20221__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_u64)))
20222svuint32_t svaddhnt(svuint32_t, svuint64_t, svuint64_t);
20223__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_u16)))
20224svuint8_t svaddhnt(svuint8_t, svuint16_t, svuint16_t);
20225__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_s32)))
20226svint16_t svaddhnt(svint16_t, svint32_t, svint32_t);
20227__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_s64)))
20228svint32_t svaddhnt(svint32_t, svint64_t, svint64_t);
20229__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddhnt_s16)))
20230svint8_t svaddhnt(svint8_t, svint16_t, svint16_t);
20231__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_n_s32)))
20232svint32_t svaddlb(svint16_t, int16_t);
20233__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_n_s64)))
20234svint64_t svaddlb(svint32_t, int32_t);
20235__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_n_s16)))
20236svint16_t svaddlb(svint8_t, int8_t);
20237__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_n_u32)))
20238svuint32_t svaddlb(svuint16_t, uint16_t);
20239__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_n_u64)))
20240svuint64_t svaddlb(svuint32_t, uint32_t);
20241__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_n_u16)))
20242svuint16_t svaddlb(svuint8_t, uint8_t);
20243__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_s32)))
20244svint32_t svaddlb(svint16_t, svint16_t);
20245__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_s64)))
20246svint64_t svaddlb(svint32_t, svint32_t);
20247__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_s16)))
20248svint16_t svaddlb(svint8_t, svint8_t);
20249__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_u32)))
20250svuint32_t svaddlb(svuint16_t, svuint16_t);
20251__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_u64)))
20252svuint64_t svaddlb(svuint32_t, svuint32_t);
20253__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlb_u16)))
20254svuint16_t svaddlb(svuint8_t, svuint8_t);
20255__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlbt_n_s32)))
20256svint32_t svaddlbt(svint16_t, int16_t);
20257__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlbt_n_s64)))
20258svint64_t svaddlbt(svint32_t, int32_t);
20259__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlbt_n_s16)))
20260svint16_t svaddlbt(svint8_t, int8_t);
20261__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlbt_s32)))
20262svint32_t svaddlbt(svint16_t, svint16_t);
20263__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlbt_s64)))
20264svint64_t svaddlbt(svint32_t, svint32_t);
20265__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlbt_s16)))
20266svint16_t svaddlbt(svint8_t, svint8_t);
20267__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_n_s32)))
20268svint32_t svaddlt(svint16_t, int16_t);
20269__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_n_s64)))
20270svint64_t svaddlt(svint32_t, int32_t);
20271__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_n_s16)))
20272svint16_t svaddlt(svint8_t, int8_t);
20273__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_n_u32)))
20274svuint32_t svaddlt(svuint16_t, uint16_t);
20275__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_n_u64)))
20276svuint64_t svaddlt(svuint32_t, uint32_t);
20277__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_n_u16)))
20278svuint16_t svaddlt(svuint8_t, uint8_t);
20279__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_s32)))
20280svint32_t svaddlt(svint16_t, svint16_t);
20281__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_s64)))
20282svint64_t svaddlt(svint32_t, svint32_t);
20283__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_s16)))
20284svint16_t svaddlt(svint8_t, svint8_t);
20285__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_u32)))
20286svuint32_t svaddlt(svuint16_t, svuint16_t);
20287__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_u64)))
20288svuint64_t svaddlt(svuint32_t, svuint32_t);
20289__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddlt_u16)))
20290svuint16_t svaddlt(svuint8_t, svuint8_t);
20291__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_f64_m)))
20292svfloat64_t svaddp_m(svbool_t, svfloat64_t, svfloat64_t);
20293__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_f32_m)))
20294svfloat32_t svaddp_m(svbool_t, svfloat32_t, svfloat32_t);
20295__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_f16_m)))
20296svfloat16_t svaddp_m(svbool_t, svfloat16_t, svfloat16_t);
20297__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_f64_x)))
20298svfloat64_t svaddp_x(svbool_t, svfloat64_t, svfloat64_t);
20299__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_f32_x)))
20300svfloat32_t svaddp_x(svbool_t, svfloat32_t, svfloat32_t);
20301__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_f16_x)))
20302svfloat16_t svaddp_x(svbool_t, svfloat16_t, svfloat16_t);
20303__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u8_m)))
20304svuint8_t svaddp_m(svbool_t, svuint8_t, svuint8_t);
20305__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u32_m)))
20306svuint32_t svaddp_m(svbool_t, svuint32_t, svuint32_t);
20307__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u64_m)))
20308svuint64_t svaddp_m(svbool_t, svuint64_t, svuint64_t);
20309__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u16_m)))
20310svuint16_t svaddp_m(svbool_t, svuint16_t, svuint16_t);
20311__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s8_m)))
20312svint8_t svaddp_m(svbool_t, svint8_t, svint8_t);
20313__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s32_m)))
20314svint32_t svaddp_m(svbool_t, svint32_t, svint32_t);
20315__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s64_m)))
20316svint64_t svaddp_m(svbool_t, svint64_t, svint64_t);
20317__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s16_m)))
20318svint16_t svaddp_m(svbool_t, svint16_t, svint16_t);
20319__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u8_x)))
20320svuint8_t svaddp_x(svbool_t, svuint8_t, svuint8_t);
20321__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u32_x)))
20322svuint32_t svaddp_x(svbool_t, svuint32_t, svuint32_t);
20323__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u64_x)))
20324svuint64_t svaddp_x(svbool_t, svuint64_t, svuint64_t);
20325__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_u16_x)))
20326svuint16_t svaddp_x(svbool_t, svuint16_t, svuint16_t);
20327__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s8_x)))
20328svint8_t svaddp_x(svbool_t, svint8_t, svint8_t);
20329__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s32_x)))
20330svint32_t svaddp_x(svbool_t, svint32_t, svint32_t);
20331__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s64_x)))
20332svint64_t svaddp_x(svbool_t, svint64_t, svint64_t);
20333__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddp_s16_x)))
20334svint16_t svaddp_x(svbool_t, svint16_t, svint16_t);
20335__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_n_s32)))
20336svint32_t svaddwb(svint32_t, int16_t);
20337__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_n_s64)))
20338svint64_t svaddwb(svint64_t, int32_t);
20339__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_n_s16)))
20340svint16_t svaddwb(svint16_t, int8_t);
20341__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_n_u32)))
20342svuint32_t svaddwb(svuint32_t, uint16_t);
20343__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_n_u64)))
20344svuint64_t svaddwb(svuint64_t, uint32_t);
20345__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_n_u16)))
20346svuint16_t svaddwb(svuint16_t, uint8_t);
20347__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_s32)))
20348svint32_t svaddwb(svint32_t, svint16_t);
20349__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_s64)))
20350svint64_t svaddwb(svint64_t, svint32_t);
20351__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_s16)))
20352svint16_t svaddwb(svint16_t, svint8_t);
20353__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_u32)))
20354svuint32_t svaddwb(svuint32_t, svuint16_t);
20355__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_u64)))
20356svuint64_t svaddwb(svuint64_t, svuint32_t);
20357__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwb_u16)))
20358svuint16_t svaddwb(svuint16_t, svuint8_t);
20359__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_n_s32)))
20360svint32_t svaddwt(svint32_t, int16_t);
20361__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_n_s64)))
20362svint64_t svaddwt(svint64_t, int32_t);
20363__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_n_s16)))
20364svint16_t svaddwt(svint16_t, int8_t);
20365__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_n_u32)))
20366svuint32_t svaddwt(svuint32_t, uint16_t);
20367__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_n_u64)))
20368svuint64_t svaddwt(svuint64_t, uint32_t);
20369__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_n_u16)))
20370svuint16_t svaddwt(svuint16_t, uint8_t);
20371__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_s32)))
20372svint32_t svaddwt(svint32_t, svint16_t);
20373__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_s64)))
20374svint64_t svaddwt(svint64_t, svint32_t);
20375__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_s16)))
20376svint16_t svaddwt(svint16_t, svint8_t);
20377__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_u32)))
20378svuint32_t svaddwt(svuint32_t, svuint16_t);
20379__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_u64)))
20380svuint64_t svaddwt(svuint64_t, svuint32_t);
20381__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaddwt_u16)))
20382svuint16_t svaddwt(svuint16_t, svuint8_t);
20383__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_u8)))
20384svuint8_t svbcax(svuint8_t, svuint8_t, uint8_t);
20385__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_u32)))
20386svuint32_t svbcax(svuint32_t, svuint32_t, uint32_t);
20387__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_u64)))
20388svuint64_t svbcax(svuint64_t, svuint64_t, uint64_t);
20389__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_u16)))
20390svuint16_t svbcax(svuint16_t, svuint16_t, uint16_t);
20391__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_s8)))
20392svint8_t svbcax(svint8_t, svint8_t, int8_t);
20393__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_s32)))
20394svint32_t svbcax(svint32_t, svint32_t, int32_t);
20395__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_s64)))
20396svint64_t svbcax(svint64_t, svint64_t, int64_t);
20397__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_n_s16)))
20398svint16_t svbcax(svint16_t, svint16_t, int16_t);
20399__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_u8)))
20400svuint8_t svbcax(svuint8_t, svuint8_t, svuint8_t);
20401__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_u32)))
20402svuint32_t svbcax(svuint32_t, svuint32_t, svuint32_t);
20403__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_u64)))
20404svuint64_t svbcax(svuint64_t, svuint64_t, svuint64_t);
20405__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_u16)))
20406svuint16_t svbcax(svuint16_t, svuint16_t, svuint16_t);
20407__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_s8)))
20408svint8_t svbcax(svint8_t, svint8_t, svint8_t);
20409__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_s32)))
20410svint32_t svbcax(svint32_t, svint32_t, svint32_t);
20411__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_s64)))
20412svint64_t svbcax(svint64_t, svint64_t, svint64_t);
20413__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbcax_s16)))
20414svint16_t svbcax(svint16_t, svint16_t, svint16_t);
20415__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_u8)))
20416svuint8_t svbsl1n(svuint8_t, svuint8_t, uint8_t);
20417__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_u32)))
20418svuint32_t svbsl1n(svuint32_t, svuint32_t, uint32_t);
20419__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_u64)))
20420svuint64_t svbsl1n(svuint64_t, svuint64_t, uint64_t);
20421__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_u16)))
20422svuint16_t svbsl1n(svuint16_t, svuint16_t, uint16_t);
20423__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_s8)))
20424svint8_t svbsl1n(svint8_t, svint8_t, int8_t);
20425__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_s32)))
20426svint32_t svbsl1n(svint32_t, svint32_t, int32_t);
20427__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_s64)))
20428svint64_t svbsl1n(svint64_t, svint64_t, int64_t);
20429__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_n_s16)))
20430svint16_t svbsl1n(svint16_t, svint16_t, int16_t);
20431__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_u8)))
20432svuint8_t svbsl1n(svuint8_t, svuint8_t, svuint8_t);
20433__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_u32)))
20434svuint32_t svbsl1n(svuint32_t, svuint32_t, svuint32_t);
20435__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_u64)))
20436svuint64_t svbsl1n(svuint64_t, svuint64_t, svuint64_t);
20437__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_u16)))
20438svuint16_t svbsl1n(svuint16_t, svuint16_t, svuint16_t);
20439__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_s8)))
20440svint8_t svbsl1n(svint8_t, svint8_t, svint8_t);
20441__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_s32)))
20442svint32_t svbsl1n(svint32_t, svint32_t, svint32_t);
20443__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_s64)))
20444svint64_t svbsl1n(svint64_t, svint64_t, svint64_t);
20445__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl1n_s16)))
20446svint16_t svbsl1n(svint16_t, svint16_t, svint16_t);
20447__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_u8)))
20448svuint8_t svbsl2n(svuint8_t, svuint8_t, uint8_t);
20449__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_u32)))
20450svuint32_t svbsl2n(svuint32_t, svuint32_t, uint32_t);
20451__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_u64)))
20452svuint64_t svbsl2n(svuint64_t, svuint64_t, uint64_t);
20453__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_u16)))
20454svuint16_t svbsl2n(svuint16_t, svuint16_t, uint16_t);
20455__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_s8)))
20456svint8_t svbsl2n(svint8_t, svint8_t, int8_t);
20457__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_s32)))
20458svint32_t svbsl2n(svint32_t, svint32_t, int32_t);
20459__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_s64)))
20460svint64_t svbsl2n(svint64_t, svint64_t, int64_t);
20461__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_n_s16)))
20462svint16_t svbsl2n(svint16_t, svint16_t, int16_t);
20463__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_u8)))
20464svuint8_t svbsl2n(svuint8_t, svuint8_t, svuint8_t);
20465__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_u32)))
20466svuint32_t svbsl2n(svuint32_t, svuint32_t, svuint32_t);
20467__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_u64)))
20468svuint64_t svbsl2n(svuint64_t, svuint64_t, svuint64_t);
20469__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_u16)))
20470svuint16_t svbsl2n(svuint16_t, svuint16_t, svuint16_t);
20471__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_s8)))
20472svint8_t svbsl2n(svint8_t, svint8_t, svint8_t);
20473__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_s32)))
20474svint32_t svbsl2n(svint32_t, svint32_t, svint32_t);
20475__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_s64)))
20476svint64_t svbsl2n(svint64_t, svint64_t, svint64_t);
20477__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl2n_s16)))
20478svint16_t svbsl2n(svint16_t, svint16_t, svint16_t);
20479__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_u8)))
20480svuint8_t svbsl(svuint8_t, svuint8_t, uint8_t);
20481__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_u32)))
20482svuint32_t svbsl(svuint32_t, svuint32_t, uint32_t);
20483__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_u64)))
20484svuint64_t svbsl(svuint64_t, svuint64_t, uint64_t);
20485__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_u16)))
20486svuint16_t svbsl(svuint16_t, svuint16_t, uint16_t);
20487__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_s8)))
20488svint8_t svbsl(svint8_t, svint8_t, int8_t);
20489__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_s32)))
20490svint32_t svbsl(svint32_t, svint32_t, int32_t);
20491__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_s64)))
20492svint64_t svbsl(svint64_t, svint64_t, int64_t);
20493__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_n_s16)))
20494svint16_t svbsl(svint16_t, svint16_t, int16_t);
20495__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_u8)))
20496svuint8_t svbsl(svuint8_t, svuint8_t, svuint8_t);
20497__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_u32)))
20498svuint32_t svbsl(svuint32_t, svuint32_t, svuint32_t);
20499__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_u64)))
20500svuint64_t svbsl(svuint64_t, svuint64_t, svuint64_t);
20501__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_u16)))
20502svuint16_t svbsl(svuint16_t, svuint16_t, svuint16_t);
20503__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_s8)))
20504svint8_t svbsl(svint8_t, svint8_t, svint8_t);
20505__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_s32)))
20506svint32_t svbsl(svint32_t, svint32_t, svint32_t);
20507__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_s64)))
20508svint64_t svbsl(svint64_t, svint64_t, svint64_t);
20509__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbsl_s16)))
20510svint16_t svbsl(svint16_t, svint16_t, svint16_t);
20511__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_u8)))
20512svuint8_t svcadd(svuint8_t, svuint8_t, uint64_t);
20513__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_u32)))
20514svuint32_t svcadd(svuint32_t, svuint32_t, uint64_t);
20515__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_u64)))
20516svuint64_t svcadd(svuint64_t, svuint64_t, uint64_t);
20517__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_u16)))
20518svuint16_t svcadd(svuint16_t, svuint16_t, uint64_t);
20519__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_s8)))
20520svint8_t svcadd(svint8_t, svint8_t, uint64_t);
20521__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_s32)))
20522svint32_t svcadd(svint32_t, svint32_t, uint64_t);
20523__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_s64)))
20524svint64_t svcadd(svint64_t, svint64_t, uint64_t);
20525__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcadd_s16)))
20526svint16_t svcadd(svint16_t, svint16_t, uint64_t);
20527__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcdot_s32)))
20528svint32_t svcdot(svint32_t, svint8_t, svint8_t, uint64_t);
20529__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcdot_s64)))
20530svint64_t svcdot(svint64_t, svint16_t, svint16_t, uint64_t);
20531__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcdot_lane_s32)))
20532svint32_t svcdot_lane(svint32_t, svint8_t, svint8_t, uint64_t, uint64_t);
20533__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcdot_lane_s64)))
20534svint64_t svcdot_lane(svint64_t, svint16_t, svint16_t, uint64_t, uint64_t);
20535__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_u8)))
20536svuint8_t svcmla(svuint8_t, svuint8_t, svuint8_t, uint64_t);
20537__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_u32)))
20538svuint32_t svcmla(svuint32_t, svuint32_t, svuint32_t, uint64_t);
20539__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_u64)))
20540svuint64_t svcmla(svuint64_t, svuint64_t, svuint64_t, uint64_t);
20541__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_u16)))
20542svuint16_t svcmla(svuint16_t, svuint16_t, svuint16_t, uint64_t);
20543__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_s8)))
20544svint8_t svcmla(svint8_t, svint8_t, svint8_t, uint64_t);
20545__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_s32)))
20546svint32_t svcmla(svint32_t, svint32_t, svint32_t, uint64_t);
20547__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_s64)))
20548svint64_t svcmla(svint64_t, svint64_t, svint64_t, uint64_t);
20549__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_s16)))
20550svint16_t svcmla(svint16_t, svint16_t, svint16_t, uint64_t);
20551__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_lane_u32)))
20552svuint32_t svcmla_lane(svuint32_t, svuint32_t, svuint32_t, uint64_t, uint64_t);
20553__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_lane_u16)))
20554svuint16_t svcmla_lane(svuint16_t, svuint16_t, svuint16_t, uint64_t, uint64_t);
20555__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_lane_s32)))
20556svint32_t svcmla_lane(svint32_t, svint32_t, svint32_t, uint64_t, uint64_t);
20557__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcmla_lane_s16)))
20558svint16_t svcmla_lane(svint16_t, svint16_t, svint16_t, uint64_t, uint64_t);
20559__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtlt_f32_f16_m)))
20560svfloat32_t svcvtlt_f32_m(svfloat32_t, svbool_t, svfloat16_t);
20561__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtlt_f32_f16_x)))
20562svfloat32_t svcvtlt_f32_x(svbool_t, svfloat16_t);
20563__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtlt_f64_f32_m)))
20564svfloat64_t svcvtlt_f64_m(svfloat64_t, svbool_t, svfloat32_t);
20565__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtlt_f64_f32_x)))
20566svfloat64_t svcvtlt_f64_x(svbool_t, svfloat32_t);
20567__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtnt_f16_f32_m)))
20568svfloat16_t svcvtnt_f16_m(svfloat16_t, svbool_t, svfloat32_t);
20569__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtnt_f32_f64_m)))
20570svfloat32_t svcvtnt_f32_m(svfloat32_t, svbool_t, svfloat64_t);
20571__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtx_f32_f64_m)))
20572svfloat32_t svcvtx_f32_m(svfloat32_t, svbool_t, svfloat64_t);
20573__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtx_f32_f64_x)))
20574svfloat32_t svcvtx_f32_x(svbool_t, svfloat64_t);
20575__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtx_f32_f64_z)))
20576svfloat32_t svcvtx_f32_z(svbool_t, svfloat64_t);
20577__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svcvtxnt_f32_f64_m)))
20578svfloat32_t svcvtxnt_f32_m(svfloat32_t, svbool_t, svfloat64_t);
20579__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_u8)))
20580svuint8_t sveor3(svuint8_t, svuint8_t, uint8_t);
20581__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_u32)))
20582svuint32_t sveor3(svuint32_t, svuint32_t, uint32_t);
20583__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_u64)))
20584svuint64_t sveor3(svuint64_t, svuint64_t, uint64_t);
20585__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_u16)))
20586svuint16_t sveor3(svuint16_t, svuint16_t, uint16_t);
20587__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_s8)))
20588svint8_t sveor3(svint8_t, svint8_t, int8_t);
20589__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_s32)))
20590svint32_t sveor3(svint32_t, svint32_t, int32_t);
20591__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_s64)))
20592svint64_t sveor3(svint64_t, svint64_t, int64_t);
20593__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_n_s16)))
20594svint16_t sveor3(svint16_t, svint16_t, int16_t);
20595__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_u8)))
20596svuint8_t sveor3(svuint8_t, svuint8_t, svuint8_t);
20597__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_u32)))
20598svuint32_t sveor3(svuint32_t, svuint32_t, svuint32_t);
20599__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_u64)))
20600svuint64_t sveor3(svuint64_t, svuint64_t, svuint64_t);
20601__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_u16)))
20602svuint16_t sveor3(svuint16_t, svuint16_t, svuint16_t);
20603__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_s8)))
20604svint8_t sveor3(svint8_t, svint8_t, svint8_t);
20605__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_s32)))
20606svint32_t sveor3(svint32_t, svint32_t, svint32_t);
20607__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_s64)))
20608svint64_t sveor3(svint64_t, svint64_t, svint64_t);
20609__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveor3_s16)))
20610svint16_t sveor3(svint16_t, svint16_t, svint16_t);
20611__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_u8)))
20612svuint8_t sveorbt(svuint8_t, svuint8_t, uint8_t);
20613__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_u32)))
20614svuint32_t sveorbt(svuint32_t, svuint32_t, uint32_t);
20615__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_u64)))
20616svuint64_t sveorbt(svuint64_t, svuint64_t, uint64_t);
20617__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_u16)))
20618svuint16_t sveorbt(svuint16_t, svuint16_t, uint16_t);
20619__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_s8)))
20620svint8_t sveorbt(svint8_t, svint8_t, int8_t);
20621__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_s32)))
20622svint32_t sveorbt(svint32_t, svint32_t, int32_t);
20623__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_s64)))
20624svint64_t sveorbt(svint64_t, svint64_t, int64_t);
20625__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_n_s16)))
20626svint16_t sveorbt(svint16_t, svint16_t, int16_t);
20627__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_u8)))
20628svuint8_t sveorbt(svuint8_t, svuint8_t, svuint8_t);
20629__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_u32)))
20630svuint32_t sveorbt(svuint32_t, svuint32_t, svuint32_t);
20631__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_u64)))
20632svuint64_t sveorbt(svuint64_t, svuint64_t, svuint64_t);
20633__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_u16)))
20634svuint16_t sveorbt(svuint16_t, svuint16_t, svuint16_t);
20635__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_s8)))
20636svint8_t sveorbt(svint8_t, svint8_t, svint8_t);
20637__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_s32)))
20638svint32_t sveorbt(svint32_t, svint32_t, svint32_t);
20639__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_s64)))
20640svint64_t sveorbt(svint64_t, svint64_t, svint64_t);
20641__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveorbt_s16)))
20642svint16_t sveorbt(svint16_t, svint16_t, svint16_t);
20643__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_u8)))
20644svuint8_t sveortb(svuint8_t, svuint8_t, uint8_t);
20645__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_u32)))
20646svuint32_t sveortb(svuint32_t, svuint32_t, uint32_t);
20647__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_u64)))
20648svuint64_t sveortb(svuint64_t, svuint64_t, uint64_t);
20649__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_u16)))
20650svuint16_t sveortb(svuint16_t, svuint16_t, uint16_t);
20651__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_s8)))
20652svint8_t sveortb(svint8_t, svint8_t, int8_t);
20653__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_s32)))
20654svint32_t sveortb(svint32_t, svint32_t, int32_t);
20655__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_s64)))
20656svint64_t sveortb(svint64_t, svint64_t, int64_t);
20657__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_n_s16)))
20658svint16_t sveortb(svint16_t, svint16_t, int16_t);
20659__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_u8)))
20660svuint8_t sveortb(svuint8_t, svuint8_t, svuint8_t);
20661__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_u32)))
20662svuint32_t sveortb(svuint32_t, svuint32_t, svuint32_t);
20663__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_u64)))
20664svuint64_t sveortb(svuint64_t, svuint64_t, svuint64_t);
20665__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_u16)))
20666svuint16_t sveortb(svuint16_t, svuint16_t, svuint16_t);
20667__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_s8)))
20668svint8_t sveortb(svint8_t, svint8_t, svint8_t);
20669__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_s32)))
20670svint32_t sveortb(svint32_t, svint32_t, svint32_t);
20671__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_s64)))
20672svint64_t sveortb(svint64_t, svint64_t, svint64_t);
20673__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_sveortb_s16)))
20674svint16_t sveortb(svint16_t, svint16_t, svint16_t);
20675__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s8_m)))
20676svint8_t svhadd_m(svbool_t, svint8_t, int8_t);
20677__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s32_m)))
20678svint32_t svhadd_m(svbool_t, svint32_t, int32_t);
20679__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s64_m)))
20680svint64_t svhadd_m(svbool_t, svint64_t, int64_t);
20681__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s16_m)))
20682svint16_t svhadd_m(svbool_t, svint16_t, int16_t);
20683__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s8_x)))
20684svint8_t svhadd_x(svbool_t, svint8_t, int8_t);
20685__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s32_x)))
20686svint32_t svhadd_x(svbool_t, svint32_t, int32_t);
20687__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s64_x)))
20688svint64_t svhadd_x(svbool_t, svint64_t, int64_t);
20689__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s16_x)))
20690svint16_t svhadd_x(svbool_t, svint16_t, int16_t);
20691__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s8_z)))
20692svint8_t svhadd_z(svbool_t, svint8_t, int8_t);
20693__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s32_z)))
20694svint32_t svhadd_z(svbool_t, svint32_t, int32_t);
20695__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s64_z)))
20696svint64_t svhadd_z(svbool_t, svint64_t, int64_t);
20697__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_s16_z)))
20698svint16_t svhadd_z(svbool_t, svint16_t, int16_t);
20699__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u8_m)))
20700svuint8_t svhadd_m(svbool_t, svuint8_t, uint8_t);
20701__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u32_m)))
20702svuint32_t svhadd_m(svbool_t, svuint32_t, uint32_t);
20703__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u64_m)))
20704svuint64_t svhadd_m(svbool_t, svuint64_t, uint64_t);
20705__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u16_m)))
20706svuint16_t svhadd_m(svbool_t, svuint16_t, uint16_t);
20707__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u8_x)))
20708svuint8_t svhadd_x(svbool_t, svuint8_t, uint8_t);
20709__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u32_x)))
20710svuint32_t svhadd_x(svbool_t, svuint32_t, uint32_t);
20711__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u64_x)))
20712svuint64_t svhadd_x(svbool_t, svuint64_t, uint64_t);
20713__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u16_x)))
20714svuint16_t svhadd_x(svbool_t, svuint16_t, uint16_t);
20715__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u8_z)))
20716svuint8_t svhadd_z(svbool_t, svuint8_t, uint8_t);
20717__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u32_z)))
20718svuint32_t svhadd_z(svbool_t, svuint32_t, uint32_t);
20719__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u64_z)))
20720svuint64_t svhadd_z(svbool_t, svuint64_t, uint64_t);
20721__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_n_u16_z)))
20722svuint16_t svhadd_z(svbool_t, svuint16_t, uint16_t);
20723__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s8_m)))
20724svint8_t svhadd_m(svbool_t, svint8_t, svint8_t);
20725__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s32_m)))
20726svint32_t svhadd_m(svbool_t, svint32_t, svint32_t);
20727__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s64_m)))
20728svint64_t svhadd_m(svbool_t, svint64_t, svint64_t);
20729__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s16_m)))
20730svint16_t svhadd_m(svbool_t, svint16_t, svint16_t);
20731__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s8_x)))
20732svint8_t svhadd_x(svbool_t, svint8_t, svint8_t);
20733__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s32_x)))
20734svint32_t svhadd_x(svbool_t, svint32_t, svint32_t);
20735__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s64_x)))
20736svint64_t svhadd_x(svbool_t, svint64_t, svint64_t);
20737__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s16_x)))
20738svint16_t svhadd_x(svbool_t, svint16_t, svint16_t);
20739__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s8_z)))
20740svint8_t svhadd_z(svbool_t, svint8_t, svint8_t);
20741__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s32_z)))
20742svint32_t svhadd_z(svbool_t, svint32_t, svint32_t);
20743__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s64_z)))
20744svint64_t svhadd_z(svbool_t, svint64_t, svint64_t);
20745__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_s16_z)))
20746svint16_t svhadd_z(svbool_t, svint16_t, svint16_t);
20747__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u8_m)))
20748svuint8_t svhadd_m(svbool_t, svuint8_t, svuint8_t);
20749__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u32_m)))
20750svuint32_t svhadd_m(svbool_t, svuint32_t, svuint32_t);
20751__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u64_m)))
20752svuint64_t svhadd_m(svbool_t, svuint64_t, svuint64_t);
20753__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u16_m)))
20754svuint16_t svhadd_m(svbool_t, svuint16_t, svuint16_t);
20755__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u8_x)))
20756svuint8_t svhadd_x(svbool_t, svuint8_t, svuint8_t);
20757__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u32_x)))
20758svuint32_t svhadd_x(svbool_t, svuint32_t, svuint32_t);
20759__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u64_x)))
20760svuint64_t svhadd_x(svbool_t, svuint64_t, svuint64_t);
20761__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u16_x)))
20762svuint16_t svhadd_x(svbool_t, svuint16_t, svuint16_t);
20763__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u8_z)))
20764svuint8_t svhadd_z(svbool_t, svuint8_t, svuint8_t);
20765__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u32_z)))
20766svuint32_t svhadd_z(svbool_t, svuint32_t, svuint32_t);
20767__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u64_z)))
20768svuint64_t svhadd_z(svbool_t, svuint64_t, svuint64_t);
20769__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhadd_u16_z)))
20770svuint16_t svhadd_z(svbool_t, svuint16_t, svuint16_t);
20771__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhistcnt_u32_z)))
20772svuint32_t svhistcnt_z(svbool_t, svuint32_t, svuint32_t);
20773__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhistcnt_u64_z)))
20774svuint64_t svhistcnt_z(svbool_t, svuint64_t, svuint64_t);
20775__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhistcnt_s32_z)))
20776svuint32_t svhistcnt_z(svbool_t, svint32_t, svint32_t);
20777__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhistcnt_s64_z)))
20778svuint64_t svhistcnt_z(svbool_t, svint64_t, svint64_t);
20779__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhistseg_u8)))
20780svuint8_t svhistseg(svuint8_t, svuint8_t);
20781__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhistseg_s8)))
20782svuint8_t svhistseg(svint8_t, svint8_t);
20783__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s8_m)))
20784svint8_t svhsub_m(svbool_t, svint8_t, int8_t);
20785__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s32_m)))
20786svint32_t svhsub_m(svbool_t, svint32_t, int32_t);
20787__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s64_m)))
20788svint64_t svhsub_m(svbool_t, svint64_t, int64_t);
20789__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s16_m)))
20790svint16_t svhsub_m(svbool_t, svint16_t, int16_t);
20791__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s8_x)))
20792svint8_t svhsub_x(svbool_t, svint8_t, int8_t);
20793__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s32_x)))
20794svint32_t svhsub_x(svbool_t, svint32_t, int32_t);
20795__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s64_x)))
20796svint64_t svhsub_x(svbool_t, svint64_t, int64_t);
20797__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s16_x)))
20798svint16_t svhsub_x(svbool_t, svint16_t, int16_t);
20799__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s8_z)))
20800svint8_t svhsub_z(svbool_t, svint8_t, int8_t);
20801__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s32_z)))
20802svint32_t svhsub_z(svbool_t, svint32_t, int32_t);
20803__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s64_z)))
20804svint64_t svhsub_z(svbool_t, svint64_t, int64_t);
20805__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_s16_z)))
20806svint16_t svhsub_z(svbool_t, svint16_t, int16_t);
20807__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u8_m)))
20808svuint8_t svhsub_m(svbool_t, svuint8_t, uint8_t);
20809__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u32_m)))
20810svuint32_t svhsub_m(svbool_t, svuint32_t, uint32_t);
20811__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u64_m)))
20812svuint64_t svhsub_m(svbool_t, svuint64_t, uint64_t);
20813__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u16_m)))
20814svuint16_t svhsub_m(svbool_t, svuint16_t, uint16_t);
20815__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u8_x)))
20816svuint8_t svhsub_x(svbool_t, svuint8_t, uint8_t);
20817__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u32_x)))
20818svuint32_t svhsub_x(svbool_t, svuint32_t, uint32_t);
20819__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u64_x)))
20820svuint64_t svhsub_x(svbool_t, svuint64_t, uint64_t);
20821__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u16_x)))
20822svuint16_t svhsub_x(svbool_t, svuint16_t, uint16_t);
20823__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u8_z)))
20824svuint8_t svhsub_z(svbool_t, svuint8_t, uint8_t);
20825__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u32_z)))
20826svuint32_t svhsub_z(svbool_t, svuint32_t, uint32_t);
20827__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u64_z)))
20828svuint64_t svhsub_z(svbool_t, svuint64_t, uint64_t);
20829__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_n_u16_z)))
20830svuint16_t svhsub_z(svbool_t, svuint16_t, uint16_t);
20831__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s8_m)))
20832svint8_t svhsub_m(svbool_t, svint8_t, svint8_t);
20833__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s32_m)))
20834svint32_t svhsub_m(svbool_t, svint32_t, svint32_t);
20835__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s64_m)))
20836svint64_t svhsub_m(svbool_t, svint64_t, svint64_t);
20837__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s16_m)))
20838svint16_t svhsub_m(svbool_t, svint16_t, svint16_t);
20839__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s8_x)))
20840svint8_t svhsub_x(svbool_t, svint8_t, svint8_t);
20841__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s32_x)))
20842svint32_t svhsub_x(svbool_t, svint32_t, svint32_t);
20843__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s64_x)))
20844svint64_t svhsub_x(svbool_t, svint64_t, svint64_t);
20845__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s16_x)))
20846svint16_t svhsub_x(svbool_t, svint16_t, svint16_t);
20847__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s8_z)))
20848svint8_t svhsub_z(svbool_t, svint8_t, svint8_t);
20849__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s32_z)))
20850svint32_t svhsub_z(svbool_t, svint32_t, svint32_t);
20851__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s64_z)))
20852svint64_t svhsub_z(svbool_t, svint64_t, svint64_t);
20853__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_s16_z)))
20854svint16_t svhsub_z(svbool_t, svint16_t, svint16_t);
20855__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u8_m)))
20856svuint8_t svhsub_m(svbool_t, svuint8_t, svuint8_t);
20857__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u32_m)))
20858svuint32_t svhsub_m(svbool_t, svuint32_t, svuint32_t);
20859__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u64_m)))
20860svuint64_t svhsub_m(svbool_t, svuint64_t, svuint64_t);
20861__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u16_m)))
20862svuint16_t svhsub_m(svbool_t, svuint16_t, svuint16_t);
20863__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u8_x)))
20864svuint8_t svhsub_x(svbool_t, svuint8_t, svuint8_t);
20865__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u32_x)))
20866svuint32_t svhsub_x(svbool_t, svuint32_t, svuint32_t);
20867__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u64_x)))
20868svuint64_t svhsub_x(svbool_t, svuint64_t, svuint64_t);
20869__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u16_x)))
20870svuint16_t svhsub_x(svbool_t, svuint16_t, svuint16_t);
20871__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u8_z)))
20872svuint8_t svhsub_z(svbool_t, svuint8_t, svuint8_t);
20873__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u32_z)))
20874svuint32_t svhsub_z(svbool_t, svuint32_t, svuint32_t);
20875__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u64_z)))
20876svuint64_t svhsub_z(svbool_t, svuint64_t, svuint64_t);
20877__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsub_u16_z)))
20878svuint16_t svhsub_z(svbool_t, svuint16_t, svuint16_t);
20879__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s8_m)))
20880svint8_t svhsubr_m(svbool_t, svint8_t, int8_t);
20881__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s32_m)))
20882svint32_t svhsubr_m(svbool_t, svint32_t, int32_t);
20883__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s64_m)))
20884svint64_t svhsubr_m(svbool_t, svint64_t, int64_t);
20885__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s16_m)))
20886svint16_t svhsubr_m(svbool_t, svint16_t, int16_t);
20887__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s8_x)))
20888svint8_t svhsubr_x(svbool_t, svint8_t, int8_t);
20889__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s32_x)))
20890svint32_t svhsubr_x(svbool_t, svint32_t, int32_t);
20891__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s64_x)))
20892svint64_t svhsubr_x(svbool_t, svint64_t, int64_t);
20893__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s16_x)))
20894svint16_t svhsubr_x(svbool_t, svint16_t, int16_t);
20895__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s8_z)))
20896svint8_t svhsubr_z(svbool_t, svint8_t, int8_t);
20897__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s32_z)))
20898svint32_t svhsubr_z(svbool_t, svint32_t, int32_t);
20899__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s64_z)))
20900svint64_t svhsubr_z(svbool_t, svint64_t, int64_t);
20901__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_s16_z)))
20902svint16_t svhsubr_z(svbool_t, svint16_t, int16_t);
20903__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u8_m)))
20904svuint8_t svhsubr_m(svbool_t, svuint8_t, uint8_t);
20905__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u32_m)))
20906svuint32_t svhsubr_m(svbool_t, svuint32_t, uint32_t);
20907__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u64_m)))
20908svuint64_t svhsubr_m(svbool_t, svuint64_t, uint64_t);
20909__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u16_m)))
20910svuint16_t svhsubr_m(svbool_t, svuint16_t, uint16_t);
20911__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u8_x)))
20912svuint8_t svhsubr_x(svbool_t, svuint8_t, uint8_t);
20913__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u32_x)))
20914svuint32_t svhsubr_x(svbool_t, svuint32_t, uint32_t);
20915__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u64_x)))
20916svuint64_t svhsubr_x(svbool_t, svuint64_t, uint64_t);
20917__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u16_x)))
20918svuint16_t svhsubr_x(svbool_t, svuint16_t, uint16_t);
20919__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u8_z)))
20920svuint8_t svhsubr_z(svbool_t, svuint8_t, uint8_t);
20921__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u32_z)))
20922svuint32_t svhsubr_z(svbool_t, svuint32_t, uint32_t);
20923__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u64_z)))
20924svuint64_t svhsubr_z(svbool_t, svuint64_t, uint64_t);
20925__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_n_u16_z)))
20926svuint16_t svhsubr_z(svbool_t, svuint16_t, uint16_t);
20927__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s8_m)))
20928svint8_t svhsubr_m(svbool_t, svint8_t, svint8_t);
20929__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s32_m)))
20930svint32_t svhsubr_m(svbool_t, svint32_t, svint32_t);
20931__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s64_m)))
20932svint64_t svhsubr_m(svbool_t, svint64_t, svint64_t);
20933__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s16_m)))
20934svint16_t svhsubr_m(svbool_t, svint16_t, svint16_t);
20935__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s8_x)))
20936svint8_t svhsubr_x(svbool_t, svint8_t, svint8_t);
20937__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s32_x)))
20938svint32_t svhsubr_x(svbool_t, svint32_t, svint32_t);
20939__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s64_x)))
20940svint64_t svhsubr_x(svbool_t, svint64_t, svint64_t);
20941__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s16_x)))
20942svint16_t svhsubr_x(svbool_t, svint16_t, svint16_t);
20943__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s8_z)))
20944svint8_t svhsubr_z(svbool_t, svint8_t, svint8_t);
20945__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s32_z)))
20946svint32_t svhsubr_z(svbool_t, svint32_t, svint32_t);
20947__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s64_z)))
20948svint64_t svhsubr_z(svbool_t, svint64_t, svint64_t);
20949__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_s16_z)))
20950svint16_t svhsubr_z(svbool_t, svint16_t, svint16_t);
20951__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u8_m)))
20952svuint8_t svhsubr_m(svbool_t, svuint8_t, svuint8_t);
20953__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u32_m)))
20954svuint32_t svhsubr_m(svbool_t, svuint32_t, svuint32_t);
20955__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u64_m)))
20956svuint64_t svhsubr_m(svbool_t, svuint64_t, svuint64_t);
20957__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u16_m)))
20958svuint16_t svhsubr_m(svbool_t, svuint16_t, svuint16_t);
20959__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u8_x)))
20960svuint8_t svhsubr_x(svbool_t, svuint8_t, svuint8_t);
20961__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u32_x)))
20962svuint32_t svhsubr_x(svbool_t, svuint32_t, svuint32_t);
20963__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u64_x)))
20964svuint64_t svhsubr_x(svbool_t, svuint64_t, svuint64_t);
20965__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u16_x)))
20966svuint16_t svhsubr_x(svbool_t, svuint16_t, svuint16_t);
20967__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u8_z)))
20968svuint8_t svhsubr_z(svbool_t, svuint8_t, svuint8_t);
20969__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u32_z)))
20970svuint32_t svhsubr_z(svbool_t, svuint32_t, svuint32_t);
20971__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u64_z)))
20972svuint64_t svhsubr_z(svbool_t, svuint64_t, svuint64_t);
20973__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svhsubr_u16_z)))
20974svuint16_t svhsubr_z(svbool_t, svuint16_t, svuint16_t);
20975__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_index_u32)))
20976svuint32_t svldnt1_gather_index_u32(svbool_t, svuint32_t, int64_t);
20977__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_index_u64)))
20978svuint64_t svldnt1_gather_index_u64(svbool_t, svuint64_t, int64_t);
20979__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_index_f64)))
20980svfloat64_t svldnt1_gather_index_f64(svbool_t, svuint64_t, int64_t);
20981__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_index_f32)))
20982svfloat32_t svldnt1_gather_index_f32(svbool_t, svuint32_t, int64_t);
20983__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_index_s32)))
20984svint32_t svldnt1_gather_index_s32(svbool_t, svuint32_t, int64_t);
20985__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_index_s64)))
20986svint64_t svldnt1_gather_index_s64(svbool_t, svuint64_t, int64_t);
20987__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_offset_u32)))
20988svuint32_t svldnt1_gather_offset_u32(svbool_t, svuint32_t, int64_t);
20989__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_offset_u64)))
20990svuint64_t svldnt1_gather_offset_u64(svbool_t, svuint64_t, int64_t);
20991__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_offset_f64)))
20992svfloat64_t svldnt1_gather_offset_f64(svbool_t, svuint64_t, int64_t);
20993__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_offset_f32)))
20994svfloat32_t svldnt1_gather_offset_f32(svbool_t, svuint32_t, int64_t);
20995__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_offset_s32)))
20996svint32_t svldnt1_gather_offset_s32(svbool_t, svuint32_t, int64_t);
20997__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_offset_s64)))
20998svint64_t svldnt1_gather_offset_s64(svbool_t, svuint64_t, int64_t);
20999__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_u32)))
21000svuint32_t svldnt1_gather_u32(svbool_t, svuint32_t);
21001__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_u64)))
21002svuint64_t svldnt1_gather_u64(svbool_t, svuint64_t);
21003__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_f64)))
21004svfloat64_t svldnt1_gather_f64(svbool_t, svuint64_t);
21005__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_f32)))
21006svfloat32_t svldnt1_gather_f32(svbool_t, svuint32_t);
21007__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32base_s32)))
21008svint32_t svldnt1_gather_s32(svbool_t, svuint32_t);
21009__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64base_s64)))
21010svint64_t svldnt1_gather_s64(svbool_t, svuint64_t);
21011__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_s64index_u64)))
21012svuint64_t svldnt1_gather_index(svbool_t, uint64_t const *, svint64_t);
21013__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_s64index_f64)))
21014svfloat64_t svldnt1_gather_index(svbool_t, float64_t const *, svint64_t);
21015__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_s64index_s64)))
21016svint64_t svldnt1_gather_index(svbool_t, int64_t const *, svint64_t);
21017__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64index_u64)))
21018svuint64_t svldnt1_gather_index(svbool_t, uint64_t const *, svuint64_t);
21019__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64index_f64)))
21020svfloat64_t svldnt1_gather_index(svbool_t, float64_t const *, svuint64_t);
21021__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64index_s64)))
21022svint64_t svldnt1_gather_index(svbool_t, int64_t const *, svuint64_t);
21023__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32offset_u32)))
21024svuint32_t svldnt1_gather_offset(svbool_t, uint32_t const *, svuint32_t);
21025__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32offset_f32)))
21026svfloat32_t svldnt1_gather_offset(svbool_t, float32_t const *, svuint32_t);
21027__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u32offset_s32)))
21028svint32_t svldnt1_gather_offset(svbool_t, int32_t const *, svuint32_t);
21029__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_s64offset_u64)))
21030svuint64_t svldnt1_gather_offset(svbool_t, uint64_t const *, svint64_t);
21031__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_s64offset_f64)))
21032svfloat64_t svldnt1_gather_offset(svbool_t, float64_t const *, svint64_t);
21033__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_s64offset_s64)))
21034svint64_t svldnt1_gather_offset(svbool_t, int64_t const *, svint64_t);
21035__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64offset_u64)))
21036svuint64_t svldnt1_gather_offset(svbool_t, uint64_t const *, svuint64_t);
21037__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64offset_f64)))
21038svfloat64_t svldnt1_gather_offset(svbool_t, float64_t const *, svuint64_t);
21039__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1_gather_u64offset_s64)))
21040svint64_t svldnt1_gather_offset(svbool_t, int64_t const *, svuint64_t);
21041__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u32base_offset_u32)))
21042svuint32_t svldnt1sb_gather_offset_u32(svbool_t, svuint32_t, int64_t);
21043__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u64base_offset_u64)))
21044svuint64_t svldnt1sb_gather_offset_u64(svbool_t, svuint64_t, int64_t);
21045__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u32base_offset_s32)))
21046svint32_t svldnt1sb_gather_offset_s32(svbool_t, svuint32_t, int64_t);
21047__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u64base_offset_s64)))
21048svint64_t svldnt1sb_gather_offset_s64(svbool_t, svuint64_t, int64_t);
21049__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u32base_u32)))
21050svuint32_t svldnt1sb_gather_u32(svbool_t, svuint32_t);
21051__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u64base_u64)))
21052svuint64_t svldnt1sb_gather_u64(svbool_t, svuint64_t);
21053__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u32base_s32)))
21054svint32_t svldnt1sb_gather_s32(svbool_t, svuint32_t);
21055__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u64base_s64)))
21056svint64_t svldnt1sb_gather_s64(svbool_t, svuint64_t);
21057__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u32offset_u32)))
21058svuint32_t svldnt1sb_gather_offset_u32(svbool_t, int8_t const *, svuint32_t);
21059__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u32offset_s32)))
21060svint32_t svldnt1sb_gather_offset_s32(svbool_t, int8_t const *, svuint32_t);
21061__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_s64offset_u64)))
21062svuint64_t svldnt1sb_gather_offset_u64(svbool_t, int8_t const *, svint64_t);
21063__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_s64offset_s64)))
21064svint64_t svldnt1sb_gather_offset_s64(svbool_t, int8_t const *, svint64_t);
21065__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u64offset_u64)))
21066svuint64_t svldnt1sb_gather_offset_u64(svbool_t, int8_t const *, svuint64_t);
21067__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sb_gather_u64offset_s64)))
21068svint64_t svldnt1sb_gather_offset_s64(svbool_t, int8_t const *, svuint64_t);
21069__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32base_index_u32)))
21070svuint32_t svldnt1sh_gather_index_u32(svbool_t, svuint32_t, int64_t);
21071__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64base_index_u64)))
21072svuint64_t svldnt1sh_gather_index_u64(svbool_t, svuint64_t, int64_t);
21073__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32base_index_s32)))
21074svint32_t svldnt1sh_gather_index_s32(svbool_t, svuint32_t, int64_t);
21075__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64base_index_s64)))
21076svint64_t svldnt1sh_gather_index_s64(svbool_t, svuint64_t, int64_t);
21077__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32base_offset_u32)))
21078svuint32_t svldnt1sh_gather_offset_u32(svbool_t, svuint32_t, int64_t);
21079__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64base_offset_u64)))
21080svuint64_t svldnt1sh_gather_offset_u64(svbool_t, svuint64_t, int64_t);
21081__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32base_offset_s32)))
21082svint32_t svldnt1sh_gather_offset_s32(svbool_t, svuint32_t, int64_t);
21083__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64base_offset_s64)))
21084svint64_t svldnt1sh_gather_offset_s64(svbool_t, svuint64_t, int64_t);
21085__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32base_u32)))
21086svuint32_t svldnt1sh_gather_u32(svbool_t, svuint32_t);
21087__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64base_u64)))
21088svuint64_t svldnt1sh_gather_u64(svbool_t, svuint64_t);
21089__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32base_s32)))
21090svint32_t svldnt1sh_gather_s32(svbool_t, svuint32_t);
21091__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64base_s64)))
21092svint64_t svldnt1sh_gather_s64(svbool_t, svuint64_t);
21093__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_s64index_u64)))
21094svuint64_t svldnt1sh_gather_index_u64(svbool_t, int16_t const *, svint64_t);
21095__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_s64index_s64)))
21096svint64_t svldnt1sh_gather_index_s64(svbool_t, int16_t const *, svint64_t);
21097__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64index_u64)))
21098svuint64_t svldnt1sh_gather_index_u64(svbool_t, int16_t const *, svuint64_t);
21099__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64index_s64)))
21100svint64_t svldnt1sh_gather_index_s64(svbool_t, int16_t const *, svuint64_t);
21101__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32offset_u32)))
21102svuint32_t svldnt1sh_gather_offset_u32(svbool_t, int16_t const *, svuint32_t);
21103__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u32offset_s32)))
21104svint32_t svldnt1sh_gather_offset_s32(svbool_t, int16_t const *, svuint32_t);
21105__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_s64offset_u64)))
21106svuint64_t svldnt1sh_gather_offset_u64(svbool_t, int16_t const *, svint64_t);
21107__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_s64offset_s64)))
21108svint64_t svldnt1sh_gather_offset_s64(svbool_t, int16_t const *, svint64_t);
21109__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64offset_u64)))
21110svuint64_t svldnt1sh_gather_offset_u64(svbool_t, int16_t const *, svuint64_t);
21111__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sh_gather_u64offset_s64)))
21112svint64_t svldnt1sh_gather_offset_s64(svbool_t, int16_t const *, svuint64_t);
21113__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64base_index_u64)))
21114svuint64_t svldnt1sw_gather_index_u64(svbool_t, svuint64_t, int64_t);
21115__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64base_index_s64)))
21116svint64_t svldnt1sw_gather_index_s64(svbool_t, svuint64_t, int64_t);
21117__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64base_offset_u64)))
21118svuint64_t svldnt1sw_gather_offset_u64(svbool_t, svuint64_t, int64_t);
21119__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64base_offset_s64)))
21120svint64_t svldnt1sw_gather_offset_s64(svbool_t, svuint64_t, int64_t);
21121__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64base_u64)))
21122svuint64_t svldnt1sw_gather_u64(svbool_t, svuint64_t);
21123__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64base_s64)))
21124svint64_t svldnt1sw_gather_s64(svbool_t, svuint64_t);
21125__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_s64index_u64)))
21126svuint64_t svldnt1sw_gather_index_u64(svbool_t, int32_t const *, svint64_t);
21127__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_s64index_s64)))
21128svint64_t svldnt1sw_gather_index_s64(svbool_t, int32_t const *, svint64_t);
21129__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64index_u64)))
21130svuint64_t svldnt1sw_gather_index_u64(svbool_t, int32_t const *, svuint64_t);
21131__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64index_s64)))
21132svint64_t svldnt1sw_gather_index_s64(svbool_t, int32_t const *, svuint64_t);
21133__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_s64offset_u64)))
21134svuint64_t svldnt1sw_gather_offset_u64(svbool_t, int32_t const *, svint64_t);
21135__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_s64offset_s64)))
21136svint64_t svldnt1sw_gather_offset_s64(svbool_t, int32_t const *, svint64_t);
21137__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64offset_u64)))
21138svuint64_t svldnt1sw_gather_offset_u64(svbool_t, int32_t const *, svuint64_t);
21139__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1sw_gather_u64offset_s64)))
21140svint64_t svldnt1sw_gather_offset_s64(svbool_t, int32_t const *, svuint64_t);
21141__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u32base_offset_u32)))
21142svuint32_t svldnt1ub_gather_offset_u32(svbool_t, svuint32_t, int64_t);
21143__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u64base_offset_u64)))
21144svuint64_t svldnt1ub_gather_offset_u64(svbool_t, svuint64_t, int64_t);
21145__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u32base_offset_s32)))
21146svint32_t svldnt1ub_gather_offset_s32(svbool_t, svuint32_t, int64_t);
21147__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u64base_offset_s64)))
21148svint64_t svldnt1ub_gather_offset_s64(svbool_t, svuint64_t, int64_t);
21149__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u32base_u32)))
21150svuint32_t svldnt1ub_gather_u32(svbool_t, svuint32_t);
21151__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u64base_u64)))
21152svuint64_t svldnt1ub_gather_u64(svbool_t, svuint64_t);
21153__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u32base_s32)))
21154svint32_t svldnt1ub_gather_s32(svbool_t, svuint32_t);
21155__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u64base_s64)))
21156svint64_t svldnt1ub_gather_s64(svbool_t, svuint64_t);
21157__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u32offset_u32)))
21158svuint32_t svldnt1ub_gather_offset_u32(svbool_t, uint8_t const *, svuint32_t);
21159__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u32offset_s32)))
21160svint32_t svldnt1ub_gather_offset_s32(svbool_t, uint8_t const *, svuint32_t);
21161__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_s64offset_u64)))
21162svuint64_t svldnt1ub_gather_offset_u64(svbool_t, uint8_t const *, svint64_t);
21163__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_s64offset_s64)))
21164svint64_t svldnt1ub_gather_offset_s64(svbool_t, uint8_t const *, svint64_t);
21165__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u64offset_u64)))
21166svuint64_t svldnt1ub_gather_offset_u64(svbool_t, uint8_t const *, svuint64_t);
21167__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1ub_gather_u64offset_s64)))
21168svint64_t svldnt1ub_gather_offset_s64(svbool_t, uint8_t const *, svuint64_t);
21169__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32base_index_u32)))
21170svuint32_t svldnt1uh_gather_index_u32(svbool_t, svuint32_t, int64_t);
21171__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64base_index_u64)))
21172svuint64_t svldnt1uh_gather_index_u64(svbool_t, svuint64_t, int64_t);
21173__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32base_index_s32)))
21174svint32_t svldnt1uh_gather_index_s32(svbool_t, svuint32_t, int64_t);
21175__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64base_index_s64)))
21176svint64_t svldnt1uh_gather_index_s64(svbool_t, svuint64_t, int64_t);
21177__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32base_offset_u32)))
21178svuint32_t svldnt1uh_gather_offset_u32(svbool_t, svuint32_t, int64_t);
21179__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64base_offset_u64)))
21180svuint64_t svldnt1uh_gather_offset_u64(svbool_t, svuint64_t, int64_t);
21181__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32base_offset_s32)))
21182svint32_t svldnt1uh_gather_offset_s32(svbool_t, svuint32_t, int64_t);
21183__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64base_offset_s64)))
21184svint64_t svldnt1uh_gather_offset_s64(svbool_t, svuint64_t, int64_t);
21185__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32base_u32)))
21186svuint32_t svldnt1uh_gather_u32(svbool_t, svuint32_t);
21187__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64base_u64)))
21188svuint64_t svldnt1uh_gather_u64(svbool_t, svuint64_t);
21189__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32base_s32)))
21190svint32_t svldnt1uh_gather_s32(svbool_t, svuint32_t);
21191__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64base_s64)))
21192svint64_t svldnt1uh_gather_s64(svbool_t, svuint64_t);
21193__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_s64index_u64)))
21194svuint64_t svldnt1uh_gather_index_u64(svbool_t, uint16_t const *, svint64_t);
21195__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_s64index_s64)))
21196svint64_t svldnt1uh_gather_index_s64(svbool_t, uint16_t const *, svint64_t);
21197__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64index_u64)))
21198svuint64_t svldnt1uh_gather_index_u64(svbool_t, uint16_t const *, svuint64_t);
21199__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64index_s64)))
21200svint64_t svldnt1uh_gather_index_s64(svbool_t, uint16_t const *, svuint64_t);
21201__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32offset_u32)))
21202svuint32_t svldnt1uh_gather_offset_u32(svbool_t, uint16_t const *, svuint32_t);
21203__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u32offset_s32)))
21204svint32_t svldnt1uh_gather_offset_s32(svbool_t, uint16_t const *, svuint32_t);
21205__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_s64offset_u64)))
21206svuint64_t svldnt1uh_gather_offset_u64(svbool_t, uint16_t const *, svint64_t);
21207__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_s64offset_s64)))
21208svint64_t svldnt1uh_gather_offset_s64(svbool_t, uint16_t const *, svint64_t);
21209__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64offset_u64)))
21210svuint64_t svldnt1uh_gather_offset_u64(svbool_t, uint16_t const *, svuint64_t);
21211__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uh_gather_u64offset_s64)))
21212svint64_t svldnt1uh_gather_offset_s64(svbool_t, uint16_t const *, svuint64_t);
21213__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64base_index_u64)))
21214svuint64_t svldnt1uw_gather_index_u64(svbool_t, svuint64_t, int64_t);
21215__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64base_index_s64)))
21216svint64_t svldnt1uw_gather_index_s64(svbool_t, svuint64_t, int64_t);
21217__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64base_offset_u64)))
21218svuint64_t svldnt1uw_gather_offset_u64(svbool_t, svuint64_t, int64_t);
21219__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64base_offset_s64)))
21220svint64_t svldnt1uw_gather_offset_s64(svbool_t, svuint64_t, int64_t);
21221__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64base_u64)))
21222svuint64_t svldnt1uw_gather_u64(svbool_t, svuint64_t);
21223__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64base_s64)))
21224svint64_t svldnt1uw_gather_s64(svbool_t, svuint64_t);
21225__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_s64index_u64)))
21226svuint64_t svldnt1uw_gather_index_u64(svbool_t, uint32_t const *, svint64_t);
21227__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_s64index_s64)))
21228svint64_t svldnt1uw_gather_index_s64(svbool_t, uint32_t const *, svint64_t);
21229__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64index_u64)))
21230svuint64_t svldnt1uw_gather_index_u64(svbool_t, uint32_t const *, svuint64_t);
21231__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64index_s64)))
21232svint64_t svldnt1uw_gather_index_s64(svbool_t, uint32_t const *, svuint64_t);
21233__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_s64offset_u64)))
21234svuint64_t svldnt1uw_gather_offset_u64(svbool_t, uint32_t const *, svint64_t);
21235__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_s64offset_s64)))
21236svint64_t svldnt1uw_gather_offset_s64(svbool_t, uint32_t const *, svint64_t);
21237__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64offset_u64)))
21238svuint64_t svldnt1uw_gather_offset_u64(svbool_t, uint32_t const *, svuint64_t);
21239__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svldnt1uw_gather_u64offset_s64)))
21240svint64_t svldnt1uw_gather_offset_s64(svbool_t, uint32_t const *, svuint64_t);
21241__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f64_m)))
21242svint64_t svlogb_m(svint64_t, svbool_t, svfloat64_t);
21243__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f32_m)))
21244svint32_t svlogb_m(svint32_t, svbool_t, svfloat32_t);
21245__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f16_m)))
21246svint16_t svlogb_m(svint16_t, svbool_t, svfloat16_t);
21247__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f64_x)))
21248svint64_t svlogb_x(svbool_t, svfloat64_t);
21249__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f32_x)))
21250svint32_t svlogb_x(svbool_t, svfloat32_t);
21251__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f16_x)))
21252svint16_t svlogb_x(svbool_t, svfloat16_t);
21253__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f64_z)))
21254svint64_t svlogb_z(svbool_t, svfloat64_t);
21255__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f32_z)))
21256svint32_t svlogb_z(svbool_t, svfloat32_t);
21257__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svlogb_f16_z)))
21258svint16_t svlogb_z(svbool_t, svfloat16_t);
21259__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmatch_u8)))
21260svbool_t svmatch(svbool_t, svuint8_t, svuint8_t);
21261__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmatch_u16)))
21262svbool_t svmatch(svbool_t, svuint16_t, svuint16_t);
21263__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmatch_s8)))
21264svbool_t svmatch(svbool_t, svint8_t, svint8_t);
21265__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmatch_s16)))
21266svbool_t svmatch(svbool_t, svint16_t, svint16_t);
21267__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxnmp_f64_m)))
21268svfloat64_t svmaxnmp_m(svbool_t, svfloat64_t, svfloat64_t);
21269__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxnmp_f32_m)))
21270svfloat32_t svmaxnmp_m(svbool_t, svfloat32_t, svfloat32_t);
21271__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxnmp_f16_m)))
21272svfloat16_t svmaxnmp_m(svbool_t, svfloat16_t, svfloat16_t);
21273__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxnmp_f64_x)))
21274svfloat64_t svmaxnmp_x(svbool_t, svfloat64_t, svfloat64_t);
21275__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxnmp_f32_x)))
21276svfloat32_t svmaxnmp_x(svbool_t, svfloat32_t, svfloat32_t);
21277__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxnmp_f16_x)))
21278svfloat16_t svmaxnmp_x(svbool_t, svfloat16_t, svfloat16_t);
21279__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_f64_m)))
21280svfloat64_t svmaxp_m(svbool_t, svfloat64_t, svfloat64_t);
21281__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_f32_m)))
21282svfloat32_t svmaxp_m(svbool_t, svfloat32_t, svfloat32_t);
21283__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_f16_m)))
21284svfloat16_t svmaxp_m(svbool_t, svfloat16_t, svfloat16_t);
21285__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_f64_x)))
21286svfloat64_t svmaxp_x(svbool_t, svfloat64_t, svfloat64_t);
21287__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_f32_x)))
21288svfloat32_t svmaxp_x(svbool_t, svfloat32_t, svfloat32_t);
21289__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_f16_x)))
21290svfloat16_t svmaxp_x(svbool_t, svfloat16_t, svfloat16_t);
21291__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s8_m)))
21292svint8_t svmaxp_m(svbool_t, svint8_t, svint8_t);
21293__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s32_m)))
21294svint32_t svmaxp_m(svbool_t, svint32_t, svint32_t);
21295__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s64_m)))
21296svint64_t svmaxp_m(svbool_t, svint64_t, svint64_t);
21297__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s16_m)))
21298svint16_t svmaxp_m(svbool_t, svint16_t, svint16_t);
21299__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s8_x)))
21300svint8_t svmaxp_x(svbool_t, svint8_t, svint8_t);
21301__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s32_x)))
21302svint32_t svmaxp_x(svbool_t, svint32_t, svint32_t);
21303__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s64_x)))
21304svint64_t svmaxp_x(svbool_t, svint64_t, svint64_t);
21305__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_s16_x)))
21306svint16_t svmaxp_x(svbool_t, svint16_t, svint16_t);
21307__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u8_m)))
21308svuint8_t svmaxp_m(svbool_t, svuint8_t, svuint8_t);
21309__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u32_m)))
21310svuint32_t svmaxp_m(svbool_t, svuint32_t, svuint32_t);
21311__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u64_m)))
21312svuint64_t svmaxp_m(svbool_t, svuint64_t, svuint64_t);
21313__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u16_m)))
21314svuint16_t svmaxp_m(svbool_t, svuint16_t, svuint16_t);
21315__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u8_x)))
21316svuint8_t svmaxp_x(svbool_t, svuint8_t, svuint8_t);
21317__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u32_x)))
21318svuint32_t svmaxp_x(svbool_t, svuint32_t, svuint32_t);
21319__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u64_x)))
21320svuint64_t svmaxp_x(svbool_t, svuint64_t, svuint64_t);
21321__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmaxp_u16_x)))
21322svuint16_t svmaxp_x(svbool_t, svuint16_t, svuint16_t);
21323__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminnmp_f64_m)))
21324svfloat64_t svminnmp_m(svbool_t, svfloat64_t, svfloat64_t);
21325__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminnmp_f32_m)))
21326svfloat32_t svminnmp_m(svbool_t, svfloat32_t, svfloat32_t);
21327__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminnmp_f16_m)))
21328svfloat16_t svminnmp_m(svbool_t, svfloat16_t, svfloat16_t);
21329__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminnmp_f64_x)))
21330svfloat64_t svminnmp_x(svbool_t, svfloat64_t, svfloat64_t);
21331__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminnmp_f32_x)))
21332svfloat32_t svminnmp_x(svbool_t, svfloat32_t, svfloat32_t);
21333__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminnmp_f16_x)))
21334svfloat16_t svminnmp_x(svbool_t, svfloat16_t, svfloat16_t);
21335__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_f64_m)))
21336svfloat64_t svminp_m(svbool_t, svfloat64_t, svfloat64_t);
21337__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_f32_m)))
21338svfloat32_t svminp_m(svbool_t, svfloat32_t, svfloat32_t);
21339__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_f16_m)))
21340svfloat16_t svminp_m(svbool_t, svfloat16_t, svfloat16_t);
21341__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_f64_x)))
21342svfloat64_t svminp_x(svbool_t, svfloat64_t, svfloat64_t);
21343__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_f32_x)))
21344svfloat32_t svminp_x(svbool_t, svfloat32_t, svfloat32_t);
21345__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_f16_x)))
21346svfloat16_t svminp_x(svbool_t, svfloat16_t, svfloat16_t);
21347__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s8_m)))
21348svint8_t svminp_m(svbool_t, svint8_t, svint8_t);
21349__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s32_m)))
21350svint32_t svminp_m(svbool_t, svint32_t, svint32_t);
21351__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s64_m)))
21352svint64_t svminp_m(svbool_t, svint64_t, svint64_t);
21353__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s16_m)))
21354svint16_t svminp_m(svbool_t, svint16_t, svint16_t);
21355__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s8_x)))
21356svint8_t svminp_x(svbool_t, svint8_t, svint8_t);
21357__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s32_x)))
21358svint32_t svminp_x(svbool_t, svint32_t, svint32_t);
21359__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s64_x)))
21360svint64_t svminp_x(svbool_t, svint64_t, svint64_t);
21361__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_s16_x)))
21362svint16_t svminp_x(svbool_t, svint16_t, svint16_t);
21363__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u8_m)))
21364svuint8_t svminp_m(svbool_t, svuint8_t, svuint8_t);
21365__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u32_m)))
21366svuint32_t svminp_m(svbool_t, svuint32_t, svuint32_t);
21367__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u64_m)))
21368svuint64_t svminp_m(svbool_t, svuint64_t, svuint64_t);
21369__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u16_m)))
21370svuint16_t svminp_m(svbool_t, svuint16_t, svuint16_t);
21371__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u8_x)))
21372svuint8_t svminp_x(svbool_t, svuint8_t, svuint8_t);
21373__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u32_x)))
21374svuint32_t svminp_x(svbool_t, svuint32_t, svuint32_t);
21375__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u64_x)))
21376svuint64_t svminp_x(svbool_t, svuint64_t, svuint64_t);
21377__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svminp_u16_x)))
21378svuint16_t svminp_x(svbool_t, svuint16_t, svuint16_t);
21379__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmla_lane_u32)))
21380svuint32_t svmla_lane(svuint32_t, svuint32_t, svuint32_t, uint64_t);
21381__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmla_lane_u64)))
21382svuint64_t svmla_lane(svuint64_t, svuint64_t, svuint64_t, uint64_t);
21383__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmla_lane_u16)))
21384svuint16_t svmla_lane(svuint16_t, svuint16_t, svuint16_t, uint64_t);
21385__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmla_lane_s32)))
21386svint32_t svmla_lane(svint32_t, svint32_t, svint32_t, uint64_t);
21387__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmla_lane_s64)))
21388svint64_t svmla_lane(svint64_t, svint64_t, svint64_t, uint64_t);
21389__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmla_lane_s16)))
21390svint16_t svmla_lane(svint16_t, svint16_t, svint16_t, uint64_t);
21391__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_n_f32)))
21392svfloat32_t svmlalb(svfloat32_t, svfloat16_t, float16_t);
21393__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_n_s32)))
21394svint32_t svmlalb(svint32_t, svint16_t, int16_t);
21395__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_n_s64)))
21396svint64_t svmlalb(svint64_t, svint32_t, int32_t);
21397__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_n_s16)))
21398svint16_t svmlalb(svint16_t, svint8_t, int8_t);
21399__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_n_u32)))
21400svuint32_t svmlalb(svuint32_t, svuint16_t, uint16_t);
21401__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_n_u64)))
21402svuint64_t svmlalb(svuint64_t, svuint32_t, uint32_t);
21403__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_n_u16)))
21404svuint16_t svmlalb(svuint16_t, svuint8_t, uint8_t);
21405__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_f32)))
21406svfloat32_t svmlalb(svfloat32_t, svfloat16_t, svfloat16_t);
21407__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_s32)))
21408svint32_t svmlalb(svint32_t, svint16_t, svint16_t);
21409__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_s64)))
21410svint64_t svmlalb(svint64_t, svint32_t, svint32_t);
21411__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_s16)))
21412svint16_t svmlalb(svint16_t, svint8_t, svint8_t);
21413__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_u32)))
21414svuint32_t svmlalb(svuint32_t, svuint16_t, svuint16_t);
21415__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_u64)))
21416svuint64_t svmlalb(svuint64_t, svuint32_t, svuint32_t);
21417__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_u16)))
21418svuint16_t svmlalb(svuint16_t, svuint8_t, svuint8_t);
21419__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_lane_f32)))
21420svfloat32_t svmlalb_lane(svfloat32_t, svfloat16_t, svfloat16_t, uint64_t);
21421__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_lane_s32)))
21422svint32_t svmlalb_lane(svint32_t, svint16_t, svint16_t, uint64_t);
21423__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_lane_s64)))
21424svint64_t svmlalb_lane(svint64_t, svint32_t, svint32_t, uint64_t);
21425__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_lane_u32)))
21426svuint32_t svmlalb_lane(svuint32_t, svuint16_t, svuint16_t, uint64_t);
21427__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalb_lane_u64)))
21428svuint64_t svmlalb_lane(svuint64_t, svuint32_t, svuint32_t, uint64_t);
21429__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_n_f32)))
21430svfloat32_t svmlalt(svfloat32_t, svfloat16_t, float16_t);
21431__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_n_s32)))
21432svint32_t svmlalt(svint32_t, svint16_t, int16_t);
21433__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_n_s64)))
21434svint64_t svmlalt(svint64_t, svint32_t, int32_t);
21435__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_n_s16)))
21436svint16_t svmlalt(svint16_t, svint8_t, int8_t);
21437__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_n_u32)))
21438svuint32_t svmlalt(svuint32_t, svuint16_t, uint16_t);
21439__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_n_u64)))
21440svuint64_t svmlalt(svuint64_t, svuint32_t, uint32_t);
21441__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_n_u16)))
21442svuint16_t svmlalt(svuint16_t, svuint8_t, uint8_t);
21443__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_f32)))
21444svfloat32_t svmlalt(svfloat32_t, svfloat16_t, svfloat16_t);
21445__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_s32)))
21446svint32_t svmlalt(svint32_t, svint16_t, svint16_t);
21447__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_s64)))
21448svint64_t svmlalt(svint64_t, svint32_t, svint32_t);
21449__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_s16)))
21450svint16_t svmlalt(svint16_t, svint8_t, svint8_t);
21451__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_u32)))
21452svuint32_t svmlalt(svuint32_t, svuint16_t, svuint16_t);
21453__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_u64)))
21454svuint64_t svmlalt(svuint64_t, svuint32_t, svuint32_t);
21455__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_u16)))
21456svuint16_t svmlalt(svuint16_t, svuint8_t, svuint8_t);
21457__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_lane_f32)))
21458svfloat32_t svmlalt_lane(svfloat32_t, svfloat16_t, svfloat16_t, uint64_t);
21459__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_lane_s32)))
21460svint32_t svmlalt_lane(svint32_t, svint16_t, svint16_t, uint64_t);
21461__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_lane_s64)))
21462svint64_t svmlalt_lane(svint64_t, svint32_t, svint32_t, uint64_t);
21463__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_lane_u32)))
21464svuint32_t svmlalt_lane(svuint32_t, svuint16_t, svuint16_t, uint64_t);
21465__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlalt_lane_u64)))
21466svuint64_t svmlalt_lane(svuint64_t, svuint32_t, svuint32_t, uint64_t);
21467__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmls_lane_u32)))
21468svuint32_t svmls_lane(svuint32_t, svuint32_t, svuint32_t, uint64_t);
21469__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmls_lane_u64)))
21470svuint64_t svmls_lane(svuint64_t, svuint64_t, svuint64_t, uint64_t);
21471__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmls_lane_u16)))
21472svuint16_t svmls_lane(svuint16_t, svuint16_t, svuint16_t, uint64_t);
21473__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmls_lane_s32)))
21474svint32_t svmls_lane(svint32_t, svint32_t, svint32_t, uint64_t);
21475__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmls_lane_s64)))
21476svint64_t svmls_lane(svint64_t, svint64_t, svint64_t, uint64_t);
21477__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmls_lane_s16)))
21478svint16_t svmls_lane(svint16_t, svint16_t, svint16_t, uint64_t);
21479__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_n_f32)))
21480svfloat32_t svmlslb(svfloat32_t, svfloat16_t, float16_t);
21481__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_n_s32)))
21482svint32_t svmlslb(svint32_t, svint16_t, int16_t);
21483__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_n_s64)))
21484svint64_t svmlslb(svint64_t, svint32_t, int32_t);
21485__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_n_s16)))
21486svint16_t svmlslb(svint16_t, svint8_t, int8_t);
21487__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_n_u32)))
21488svuint32_t svmlslb(svuint32_t, svuint16_t, uint16_t);
21489__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_n_u64)))
21490svuint64_t svmlslb(svuint64_t, svuint32_t, uint32_t);
21491__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_n_u16)))
21492svuint16_t svmlslb(svuint16_t, svuint8_t, uint8_t);
21493__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_f32)))
21494svfloat32_t svmlslb(svfloat32_t, svfloat16_t, svfloat16_t);
21495__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_s32)))
21496svint32_t svmlslb(svint32_t, svint16_t, svint16_t);
21497__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_s64)))
21498svint64_t svmlslb(svint64_t, svint32_t, svint32_t);
21499__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_s16)))
21500svint16_t svmlslb(svint16_t, svint8_t, svint8_t);
21501__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_u32)))
21502svuint32_t svmlslb(svuint32_t, svuint16_t, svuint16_t);
21503__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_u64)))
21504svuint64_t svmlslb(svuint64_t, svuint32_t, svuint32_t);
21505__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_u16)))
21506svuint16_t svmlslb(svuint16_t, svuint8_t, svuint8_t);
21507__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_lane_f32)))
21508svfloat32_t svmlslb_lane(svfloat32_t, svfloat16_t, svfloat16_t, uint64_t);
21509__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_lane_s32)))
21510svint32_t svmlslb_lane(svint32_t, svint16_t, svint16_t, uint64_t);
21511__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_lane_s64)))
21512svint64_t svmlslb_lane(svint64_t, svint32_t, svint32_t, uint64_t);
21513__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_lane_u32)))
21514svuint32_t svmlslb_lane(svuint32_t, svuint16_t, svuint16_t, uint64_t);
21515__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslb_lane_u64)))
21516svuint64_t svmlslb_lane(svuint64_t, svuint32_t, svuint32_t, uint64_t);
21517__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_n_f32)))
21518svfloat32_t svmlslt(svfloat32_t, svfloat16_t, float16_t);
21519__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_n_s32)))
21520svint32_t svmlslt(svint32_t, svint16_t, int16_t);
21521__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_n_s64)))
21522svint64_t svmlslt(svint64_t, svint32_t, int32_t);
21523__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_n_s16)))
21524svint16_t svmlslt(svint16_t, svint8_t, int8_t);
21525__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_n_u32)))
21526svuint32_t svmlslt(svuint32_t, svuint16_t, uint16_t);
21527__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_n_u64)))
21528svuint64_t svmlslt(svuint64_t, svuint32_t, uint32_t);
21529__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_n_u16)))
21530svuint16_t svmlslt(svuint16_t, svuint8_t, uint8_t);
21531__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_f32)))
21532svfloat32_t svmlslt(svfloat32_t, svfloat16_t, svfloat16_t);
21533__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_s32)))
21534svint32_t svmlslt(svint32_t, svint16_t, svint16_t);
21535__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_s64)))
21536svint64_t svmlslt(svint64_t, svint32_t, svint32_t);
21537__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_s16)))
21538svint16_t svmlslt(svint16_t, svint8_t, svint8_t);
21539__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_u32)))
21540svuint32_t svmlslt(svuint32_t, svuint16_t, svuint16_t);
21541__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_u64)))
21542svuint64_t svmlslt(svuint64_t, svuint32_t, svuint32_t);
21543__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_u16)))
21544svuint16_t svmlslt(svuint16_t, svuint8_t, svuint8_t);
21545__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_lane_f32)))
21546svfloat32_t svmlslt_lane(svfloat32_t, svfloat16_t, svfloat16_t, uint64_t);
21547__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_lane_s32)))
21548svint32_t svmlslt_lane(svint32_t, svint16_t, svint16_t, uint64_t);
21549__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_lane_s64)))
21550svint64_t svmlslt_lane(svint64_t, svint32_t, svint32_t, uint64_t);
21551__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_lane_u32)))
21552svuint32_t svmlslt_lane(svuint32_t, svuint16_t, svuint16_t, uint64_t);
21553__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmlslt_lane_u64)))
21554svuint64_t svmlslt_lane(svuint64_t, svuint32_t, svuint32_t, uint64_t);
21555__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlb_s32)))
21556svint32_t svmovlb(svint16_t);
21557__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlb_s64)))
21558svint64_t svmovlb(svint32_t);
21559__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlb_s16)))
21560svint16_t svmovlb(svint8_t);
21561__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlb_u32)))
21562svuint32_t svmovlb(svuint16_t);
21563__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlb_u64)))
21564svuint64_t svmovlb(svuint32_t);
21565__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlb_u16)))
21566svuint16_t svmovlb(svuint8_t);
21567__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlt_s32)))
21568svint32_t svmovlt(svint16_t);
21569__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlt_s64)))
21570svint64_t svmovlt(svint32_t);
21571__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlt_s16)))
21572svint16_t svmovlt(svint8_t);
21573__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlt_u32)))
21574svuint32_t svmovlt(svuint16_t);
21575__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlt_u64)))
21576svuint64_t svmovlt(svuint32_t);
21577__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmovlt_u16)))
21578svuint16_t svmovlt(svuint8_t);
21579__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmul_lane_u32)))
21580svuint32_t svmul_lane(svuint32_t, svuint32_t, uint64_t);
21581__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmul_lane_u64)))
21582svuint64_t svmul_lane(svuint64_t, svuint64_t, uint64_t);
21583__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmul_lane_u16)))
21584svuint16_t svmul_lane(svuint16_t, svuint16_t, uint64_t);
21585__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmul_lane_s32)))
21586svint32_t svmul_lane(svint32_t, svint32_t, uint64_t);
21587__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmul_lane_s64)))
21588svint64_t svmul_lane(svint64_t, svint64_t, uint64_t);
21589__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmul_lane_s16)))
21590svint16_t svmul_lane(svint16_t, svint16_t, uint64_t);
21591__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_n_s32)))
21592svint32_t svmullb(svint16_t, int16_t);
21593__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_n_s64)))
21594svint64_t svmullb(svint32_t, int32_t);
21595__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_n_s16)))
21596svint16_t svmullb(svint8_t, int8_t);
21597__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_n_u32)))
21598svuint32_t svmullb(svuint16_t, uint16_t);
21599__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_n_u64)))
21600svuint64_t svmullb(svuint32_t, uint32_t);
21601__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_n_u16)))
21602svuint16_t svmullb(svuint8_t, uint8_t);
21603__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_s32)))
21604svint32_t svmullb(svint16_t, svint16_t);
21605__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_s64)))
21606svint64_t svmullb(svint32_t, svint32_t);
21607__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_s16)))
21608svint16_t svmullb(svint8_t, svint8_t);
21609__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_u32)))
21610svuint32_t svmullb(svuint16_t, svuint16_t);
21611__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_u64)))
21612svuint64_t svmullb(svuint32_t, svuint32_t);
21613__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_u16)))
21614svuint16_t svmullb(svuint8_t, svuint8_t);
21615__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_lane_s32)))
21616svint32_t svmullb_lane(svint16_t, svint16_t, uint64_t);
21617__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_lane_s64)))
21618svint64_t svmullb_lane(svint32_t, svint32_t, uint64_t);
21619__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_lane_u32)))
21620svuint32_t svmullb_lane(svuint16_t, svuint16_t, uint64_t);
21621__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullb_lane_u64)))
21622svuint64_t svmullb_lane(svuint32_t, svuint32_t, uint64_t);
21623__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_n_s32)))
21624svint32_t svmullt(svint16_t, int16_t);
21625__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_n_s64)))
21626svint64_t svmullt(svint32_t, int32_t);
21627__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_n_s16)))
21628svint16_t svmullt(svint8_t, int8_t);
21629__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_n_u32)))
21630svuint32_t svmullt(svuint16_t, uint16_t);
21631__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_n_u64)))
21632svuint64_t svmullt(svuint32_t, uint32_t);
21633__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_n_u16)))
21634svuint16_t svmullt(svuint8_t, uint8_t);
21635__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_s32)))
21636svint32_t svmullt(svint16_t, svint16_t);
21637__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_s64)))
21638svint64_t svmullt(svint32_t, svint32_t);
21639__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_s16)))
21640svint16_t svmullt(svint8_t, svint8_t);
21641__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_u32)))
21642svuint32_t svmullt(svuint16_t, svuint16_t);
21643__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_u64)))
21644svuint64_t svmullt(svuint32_t, svuint32_t);
21645__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_u16)))
21646svuint16_t svmullt(svuint8_t, svuint8_t);
21647__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_lane_s32)))
21648svint32_t svmullt_lane(svint16_t, svint16_t, uint64_t);
21649__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_lane_s64)))
21650svint64_t svmullt_lane(svint32_t, svint32_t, uint64_t);
21651__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_lane_u32)))
21652svuint32_t svmullt_lane(svuint16_t, svuint16_t, uint64_t);
21653__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svmullt_lane_u64)))
21654svuint64_t svmullt_lane(svuint32_t, svuint32_t, uint64_t);
21655__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_u8)))
21656svuint8_t svnbsl(svuint8_t, svuint8_t, uint8_t);
21657__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_u32)))
21658svuint32_t svnbsl(svuint32_t, svuint32_t, uint32_t);
21659__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_u64)))
21660svuint64_t svnbsl(svuint64_t, svuint64_t, uint64_t);
21661__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_u16)))
21662svuint16_t svnbsl(svuint16_t, svuint16_t, uint16_t);
21663__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_s8)))
21664svint8_t svnbsl(svint8_t, svint8_t, int8_t);
21665__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_s32)))
21666svint32_t svnbsl(svint32_t, svint32_t, int32_t);
21667__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_s64)))
21668svint64_t svnbsl(svint64_t, svint64_t, int64_t);
21669__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_n_s16)))
21670svint16_t svnbsl(svint16_t, svint16_t, int16_t);
21671__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_u8)))
21672svuint8_t svnbsl(svuint8_t, svuint8_t, svuint8_t);
21673__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_u32)))
21674svuint32_t svnbsl(svuint32_t, svuint32_t, svuint32_t);
21675__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_u64)))
21676svuint64_t svnbsl(svuint64_t, svuint64_t, svuint64_t);
21677__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_u16)))
21678svuint16_t svnbsl(svuint16_t, svuint16_t, svuint16_t);
21679__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_s8)))
21680svint8_t svnbsl(svint8_t, svint8_t, svint8_t);
21681__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_s32)))
21682svint32_t svnbsl(svint32_t, svint32_t, svint32_t);
21683__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_s64)))
21684svint64_t svnbsl(svint64_t, svint64_t, svint64_t);
21685__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnbsl_s16)))
21686svint16_t svnbsl(svint16_t, svint16_t, svint16_t);
21687__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnmatch_u8)))
21688svbool_t svnmatch(svbool_t, svuint8_t, svuint8_t);
21689__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnmatch_u16)))
21690svbool_t svnmatch(svbool_t, svuint16_t, svuint16_t);
21691__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnmatch_s8)))
21692svbool_t svnmatch(svbool_t, svint8_t, svint8_t);
21693__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svnmatch_s16)))
21694svbool_t svnmatch(svbool_t, svint16_t, svint16_t);
21695__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmul_n_u8)))
21696svuint8_t svpmul(svuint8_t, uint8_t);
21697__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmul_u8)))
21698svuint8_t svpmul(svuint8_t, svuint8_t);
21699__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_n_u64)))
21700svuint64_t svpmullb(svuint32_t, uint32_t);
21701__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_n_u16)))
21702svuint16_t svpmullb(svuint8_t, uint8_t);
21703__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_u64)))
21704svuint64_t svpmullb(svuint32_t, svuint32_t);
21705__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_u16)))
21706svuint16_t svpmullb(svuint8_t, svuint8_t);
21707__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_pair_n_u8)))
21708svuint8_t svpmullb_pair(svuint8_t, uint8_t);
21709__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_pair_n_u32)))
21710svuint32_t svpmullb_pair(svuint32_t, uint32_t);
21711__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_pair_u8)))
21712svuint8_t svpmullb_pair(svuint8_t, svuint8_t);
21713__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_pair_u32)))
21714svuint32_t svpmullb_pair(svuint32_t, svuint32_t);
21715__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_n_u64)))
21716svuint64_t svpmullt(svuint32_t, uint32_t);
21717__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_n_u16)))
21718svuint16_t svpmullt(svuint8_t, uint8_t);
21719__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_u64)))
21720svuint64_t svpmullt(svuint32_t, svuint32_t);
21721__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_u16)))
21722svuint16_t svpmullt(svuint8_t, svuint8_t);
21723__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_pair_n_u8)))
21724svuint8_t svpmullt_pair(svuint8_t, uint8_t);
21725__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_pair_n_u32)))
21726svuint32_t svpmullt_pair(svuint32_t, uint32_t);
21727__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_pair_u8)))
21728svuint8_t svpmullt_pair(svuint8_t, svuint8_t);
21729__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_pair_u32)))
21730svuint32_t svpmullt_pair(svuint32_t, svuint32_t);
21731__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s8_m)))
21732svint8_t svqabs_m(svint8_t, svbool_t, svint8_t);
21733__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s32_m)))
21734svint32_t svqabs_m(svint32_t, svbool_t, svint32_t);
21735__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s64_m)))
21736svint64_t svqabs_m(svint64_t, svbool_t, svint64_t);
21737__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s16_m)))
21738svint16_t svqabs_m(svint16_t, svbool_t, svint16_t);
21739__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s8_x)))
21740svint8_t svqabs_x(svbool_t, svint8_t);
21741__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s32_x)))
21742svint32_t svqabs_x(svbool_t, svint32_t);
21743__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s64_x)))
21744svint64_t svqabs_x(svbool_t, svint64_t);
21745__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s16_x)))
21746svint16_t svqabs_x(svbool_t, svint16_t);
21747__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s8_z)))
21748svint8_t svqabs_z(svbool_t, svint8_t);
21749__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s32_z)))
21750svint32_t svqabs_z(svbool_t, svint32_t);
21751__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s64_z)))
21752svint64_t svqabs_z(svbool_t, svint64_t);
21753__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqabs_s16_z)))
21754svint16_t svqabs_z(svbool_t, svint16_t);
21755__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s8_m)))
21756svint8_t svqadd_m(svbool_t, svint8_t, int8_t);
21757__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s32_m)))
21758svint32_t svqadd_m(svbool_t, svint32_t, int32_t);
21759__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s64_m)))
21760svint64_t svqadd_m(svbool_t, svint64_t, int64_t);
21761__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s16_m)))
21762svint16_t svqadd_m(svbool_t, svint16_t, int16_t);
21763__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s8_x)))
21764svint8_t svqadd_x(svbool_t, svint8_t, int8_t);
21765__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s32_x)))
21766svint32_t svqadd_x(svbool_t, svint32_t, int32_t);
21767__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s64_x)))
21768svint64_t svqadd_x(svbool_t, svint64_t, int64_t);
21769__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s16_x)))
21770svint16_t svqadd_x(svbool_t, svint16_t, int16_t);
21771__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s8_z)))
21772svint8_t svqadd_z(svbool_t, svint8_t, int8_t);
21773__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s32_z)))
21774svint32_t svqadd_z(svbool_t, svint32_t, int32_t);
21775__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s64_z)))
21776svint64_t svqadd_z(svbool_t, svint64_t, int64_t);
21777__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_s16_z)))
21778svint16_t svqadd_z(svbool_t, svint16_t, int16_t);
21779__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u8_m)))
21780svuint8_t svqadd_m(svbool_t, svuint8_t, uint8_t);
21781__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u32_m)))
21782svuint32_t svqadd_m(svbool_t, svuint32_t, uint32_t);
21783__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u64_m)))
21784svuint64_t svqadd_m(svbool_t, svuint64_t, uint64_t);
21785__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u16_m)))
21786svuint16_t svqadd_m(svbool_t, svuint16_t, uint16_t);
21787__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u8_x)))
21788svuint8_t svqadd_x(svbool_t, svuint8_t, uint8_t);
21789__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u32_x)))
21790svuint32_t svqadd_x(svbool_t, svuint32_t, uint32_t);
21791__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u64_x)))
21792svuint64_t svqadd_x(svbool_t, svuint64_t, uint64_t);
21793__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u16_x)))
21794svuint16_t svqadd_x(svbool_t, svuint16_t, uint16_t);
21795__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u8_z)))
21796svuint8_t svqadd_z(svbool_t, svuint8_t, uint8_t);
21797__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u32_z)))
21798svuint32_t svqadd_z(svbool_t, svuint32_t, uint32_t);
21799__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u64_z)))
21800svuint64_t svqadd_z(svbool_t, svuint64_t, uint64_t);
21801__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_n_u16_z)))
21802svuint16_t svqadd_z(svbool_t, svuint16_t, uint16_t);
21803__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s8_m)))
21804svint8_t svqadd_m(svbool_t, svint8_t, svint8_t);
21805__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s32_m)))
21806svint32_t svqadd_m(svbool_t, svint32_t, svint32_t);
21807__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s64_m)))
21808svint64_t svqadd_m(svbool_t, svint64_t, svint64_t);
21809__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s16_m)))
21810svint16_t svqadd_m(svbool_t, svint16_t, svint16_t);
21811__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s8_x)))
21812svint8_t svqadd_x(svbool_t, svint8_t, svint8_t);
21813__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s32_x)))
21814svint32_t svqadd_x(svbool_t, svint32_t, svint32_t);
21815__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s64_x)))
21816svint64_t svqadd_x(svbool_t, svint64_t, svint64_t);
21817__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s16_x)))
21818svint16_t svqadd_x(svbool_t, svint16_t, svint16_t);
21819__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s8_z)))
21820svint8_t svqadd_z(svbool_t, svint8_t, svint8_t);
21821__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s32_z)))
21822svint32_t svqadd_z(svbool_t, svint32_t, svint32_t);
21823__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s64_z)))
21824svint64_t svqadd_z(svbool_t, svint64_t, svint64_t);
21825__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_s16_z)))
21826svint16_t svqadd_z(svbool_t, svint16_t, svint16_t);
21827__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u8_m)))
21828svuint8_t svqadd_m(svbool_t, svuint8_t, svuint8_t);
21829__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u32_m)))
21830svuint32_t svqadd_m(svbool_t, svuint32_t, svuint32_t);
21831__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u64_m)))
21832svuint64_t svqadd_m(svbool_t, svuint64_t, svuint64_t);
21833__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u16_m)))
21834svuint16_t svqadd_m(svbool_t, svuint16_t, svuint16_t);
21835__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u8_x)))
21836svuint8_t svqadd_x(svbool_t, svuint8_t, svuint8_t);
21837__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u32_x)))
21838svuint32_t svqadd_x(svbool_t, svuint32_t, svuint32_t);
21839__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u64_x)))
21840svuint64_t svqadd_x(svbool_t, svuint64_t, svuint64_t);
21841__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u16_x)))
21842svuint16_t svqadd_x(svbool_t, svuint16_t, svuint16_t);
21843__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u8_z)))
21844svuint8_t svqadd_z(svbool_t, svuint8_t, svuint8_t);
21845__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u32_z)))
21846svuint32_t svqadd_z(svbool_t, svuint32_t, svuint32_t);
21847__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u64_z)))
21848svuint64_t svqadd_z(svbool_t, svuint64_t, svuint64_t);
21849__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqadd_u16_z)))
21850svuint16_t svqadd_z(svbool_t, svuint16_t, svuint16_t);
21851__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqcadd_s8)))
21852svint8_t svqcadd(svint8_t, svint8_t, uint64_t);
21853__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqcadd_s32)))
21854svint32_t svqcadd(svint32_t, svint32_t, uint64_t);
21855__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqcadd_s64)))
21856svint64_t svqcadd(svint64_t, svint64_t, uint64_t);
21857__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqcadd_s16)))
21858svint16_t svqcadd(svint16_t, svint16_t, uint64_t);
21859__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_n_s32)))
21860svint32_t svqdmlalb(svint32_t, svint16_t, int16_t);
21861__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_n_s64)))
21862svint64_t svqdmlalb(svint64_t, svint32_t, int32_t);
21863__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_n_s16)))
21864svint16_t svqdmlalb(svint16_t, svint8_t, int8_t);
21865__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_s32)))
21866svint32_t svqdmlalb(svint32_t, svint16_t, svint16_t);
21867__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_s64)))
21868svint64_t svqdmlalb(svint64_t, svint32_t, svint32_t);
21869__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_s16)))
21870svint16_t svqdmlalb(svint16_t, svint8_t, svint8_t);
21871__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_lane_s32)))
21872svint32_t svqdmlalb_lane(svint32_t, svint16_t, svint16_t, uint64_t);
21873__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalb_lane_s64)))
21874svint64_t svqdmlalb_lane(svint64_t, svint32_t, svint32_t, uint64_t);
21875__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalbt_n_s32)))
21876svint32_t svqdmlalbt(svint32_t, svint16_t, int16_t);
21877__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalbt_n_s64)))
21878svint64_t svqdmlalbt(svint64_t, svint32_t, int32_t);
21879__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalbt_n_s16)))
21880svint16_t svqdmlalbt(svint16_t, svint8_t, int8_t);
21881__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalbt_s32)))
21882svint32_t svqdmlalbt(svint32_t, svint16_t, svint16_t);
21883__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalbt_s64)))
21884svint64_t svqdmlalbt(svint64_t, svint32_t, svint32_t);
21885__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalbt_s16)))
21886svint16_t svqdmlalbt(svint16_t, svint8_t, svint8_t);
21887__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_n_s32)))
21888svint32_t svqdmlalt(svint32_t, svint16_t, int16_t);
21889__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_n_s64)))
21890svint64_t svqdmlalt(svint64_t, svint32_t, int32_t);
21891__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_n_s16)))
21892svint16_t svqdmlalt(svint16_t, svint8_t, int8_t);
21893__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_s32)))
21894svint32_t svqdmlalt(svint32_t, svint16_t, svint16_t);
21895__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_s64)))
21896svint64_t svqdmlalt(svint64_t, svint32_t, svint32_t);
21897__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_s16)))
21898svint16_t svqdmlalt(svint16_t, svint8_t, svint8_t);
21899__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_lane_s32)))
21900svint32_t svqdmlalt_lane(svint32_t, svint16_t, svint16_t, uint64_t);
21901__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlalt_lane_s64)))
21902svint64_t svqdmlalt_lane(svint64_t, svint32_t, svint32_t, uint64_t);
21903__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_n_s32)))
21904svint32_t svqdmlslb(svint32_t, svint16_t, int16_t);
21905__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_n_s64)))
21906svint64_t svqdmlslb(svint64_t, svint32_t, int32_t);
21907__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_n_s16)))
21908svint16_t svqdmlslb(svint16_t, svint8_t, int8_t);
21909__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_s32)))
21910svint32_t svqdmlslb(svint32_t, svint16_t, svint16_t);
21911__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_s64)))
21912svint64_t svqdmlslb(svint64_t, svint32_t, svint32_t);
21913__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_s16)))
21914svint16_t svqdmlslb(svint16_t, svint8_t, svint8_t);
21915__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_lane_s32)))
21916svint32_t svqdmlslb_lane(svint32_t, svint16_t, svint16_t, uint64_t);
21917__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslb_lane_s64)))
21918svint64_t svqdmlslb_lane(svint64_t, svint32_t, svint32_t, uint64_t);
21919__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslbt_n_s32)))
21920svint32_t svqdmlslbt(svint32_t, svint16_t, int16_t);
21921__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslbt_n_s64)))
21922svint64_t svqdmlslbt(svint64_t, svint32_t, int32_t);
21923__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslbt_n_s16)))
21924svint16_t svqdmlslbt(svint16_t, svint8_t, int8_t);
21925__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslbt_s32)))
21926svint32_t svqdmlslbt(svint32_t, svint16_t, svint16_t);
21927__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslbt_s64)))
21928svint64_t svqdmlslbt(svint64_t, svint32_t, svint32_t);
21929__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslbt_s16)))
21930svint16_t svqdmlslbt(svint16_t, svint8_t, svint8_t);
21931__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_n_s32)))
21932svint32_t svqdmlslt(svint32_t, svint16_t, int16_t);
21933__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_n_s64)))
21934svint64_t svqdmlslt(svint64_t, svint32_t, int32_t);
21935__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_n_s16)))
21936svint16_t svqdmlslt(svint16_t, svint8_t, int8_t);
21937__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_s32)))
21938svint32_t svqdmlslt(svint32_t, svint16_t, svint16_t);
21939__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_s64)))
21940svint64_t svqdmlslt(svint64_t, svint32_t, svint32_t);
21941__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_s16)))
21942svint16_t svqdmlslt(svint16_t, svint8_t, svint8_t);
21943__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_lane_s32)))
21944svint32_t svqdmlslt_lane(svint32_t, svint16_t, svint16_t, uint64_t);
21945__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmlslt_lane_s64)))
21946svint64_t svqdmlslt_lane(svint64_t, svint32_t, svint32_t, uint64_t);
21947__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_n_s8)))
21948svint8_t svqdmulh(svint8_t, int8_t);
21949__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_n_s32)))
21950svint32_t svqdmulh(svint32_t, int32_t);
21951__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_n_s64)))
21952svint64_t svqdmulh(svint64_t, int64_t);
21953__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_n_s16)))
21954svint16_t svqdmulh(svint16_t, int16_t);
21955__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_s8)))
21956svint8_t svqdmulh(svint8_t, svint8_t);
21957__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_s32)))
21958svint32_t svqdmulh(svint32_t, svint32_t);
21959__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_s64)))
21960svint64_t svqdmulh(svint64_t, svint64_t);
21961__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_s16)))
21962svint16_t svqdmulh(svint16_t, svint16_t);
21963__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_lane_s32)))
21964svint32_t svqdmulh_lane(svint32_t, svint32_t, uint64_t);
21965__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_lane_s64)))
21966svint64_t svqdmulh_lane(svint64_t, svint64_t, uint64_t);
21967__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmulh_lane_s16)))
21968svint16_t svqdmulh_lane(svint16_t, svint16_t, uint64_t);
21969__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_n_s32)))
21970svint32_t svqdmullb(svint16_t, int16_t);
21971__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_n_s64)))
21972svint64_t svqdmullb(svint32_t, int32_t);
21973__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_n_s16)))
21974svint16_t svqdmullb(svint8_t, int8_t);
21975__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_s32)))
21976svint32_t svqdmullb(svint16_t, svint16_t);
21977__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_s64)))
21978svint64_t svqdmullb(svint32_t, svint32_t);
21979__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_s16)))
21980svint16_t svqdmullb(svint8_t, svint8_t);
21981__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_lane_s32)))
21982svint32_t svqdmullb_lane(svint16_t, svint16_t, uint64_t);
21983__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullb_lane_s64)))
21984svint64_t svqdmullb_lane(svint32_t, svint32_t, uint64_t);
21985__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_n_s32)))
21986svint32_t svqdmullt(svint16_t, int16_t);
21987__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_n_s64)))
21988svint64_t svqdmullt(svint32_t, int32_t);
21989__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_n_s16)))
21990svint16_t svqdmullt(svint8_t, int8_t);
21991__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_s32)))
21992svint32_t svqdmullt(svint16_t, svint16_t);
21993__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_s64)))
21994svint64_t svqdmullt(svint32_t, svint32_t);
21995__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_s16)))
21996svint16_t svqdmullt(svint8_t, svint8_t);
21997__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_lane_s32)))
21998svint32_t svqdmullt_lane(svint16_t, svint16_t, uint64_t);
21999__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqdmullt_lane_s64)))
22000svint64_t svqdmullt_lane(svint32_t, svint32_t, uint64_t);
22001__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s8_m)))
22002svint8_t svqneg_m(svint8_t, svbool_t, svint8_t);
22003__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s32_m)))
22004svint32_t svqneg_m(svint32_t, svbool_t, svint32_t);
22005__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s64_m)))
22006svint64_t svqneg_m(svint64_t, svbool_t, svint64_t);
22007__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s16_m)))
22008svint16_t svqneg_m(svint16_t, svbool_t, svint16_t);
22009__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s8_x)))
22010svint8_t svqneg_x(svbool_t, svint8_t);
22011__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s32_x)))
22012svint32_t svqneg_x(svbool_t, svint32_t);
22013__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s64_x)))
22014svint64_t svqneg_x(svbool_t, svint64_t);
22015__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s16_x)))
22016svint16_t svqneg_x(svbool_t, svint16_t);
22017__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s8_z)))
22018svint8_t svqneg_z(svbool_t, svint8_t);
22019__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s32_z)))
22020svint32_t svqneg_z(svbool_t, svint32_t);
22021__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s64_z)))
22022svint64_t svqneg_z(svbool_t, svint64_t);
22023__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqneg_s16_z)))
22024svint16_t svqneg_z(svbool_t, svint16_t);
22025__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdcmlah_s8)))
22026svint8_t svqrdcmlah(svint8_t, svint8_t, svint8_t, uint64_t);
22027__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdcmlah_s32)))
22028svint32_t svqrdcmlah(svint32_t, svint32_t, svint32_t, uint64_t);
22029__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdcmlah_s64)))
22030svint64_t svqrdcmlah(svint64_t, svint64_t, svint64_t, uint64_t);
22031__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdcmlah_s16)))
22032svint16_t svqrdcmlah(svint16_t, svint16_t, svint16_t, uint64_t);
22033__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdcmlah_lane_s32)))
22034svint32_t svqrdcmlah_lane(svint32_t, svint32_t, svint32_t, uint64_t, uint64_t);
22035__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdcmlah_lane_s16)))
22036svint16_t svqrdcmlah_lane(svint16_t, svint16_t, svint16_t, uint64_t, uint64_t);
22037__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_n_s8)))
22038svint8_t svqrdmlah(svint8_t, svint8_t, int8_t);
22039__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_n_s32)))
22040svint32_t svqrdmlah(svint32_t, svint32_t, int32_t);
22041__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_n_s64)))
22042svint64_t svqrdmlah(svint64_t, svint64_t, int64_t);
22043__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_n_s16)))
22044svint16_t svqrdmlah(svint16_t, svint16_t, int16_t);
22045__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_s8)))
22046svint8_t svqrdmlah(svint8_t, svint8_t, svint8_t);
22047__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_s32)))
22048svint32_t svqrdmlah(svint32_t, svint32_t, svint32_t);
22049__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_s64)))
22050svint64_t svqrdmlah(svint64_t, svint64_t, svint64_t);
22051__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_s16)))
22052svint16_t svqrdmlah(svint16_t, svint16_t, svint16_t);
22053__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_lane_s32)))
22054svint32_t svqrdmlah_lane(svint32_t, svint32_t, svint32_t, uint64_t);
22055__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_lane_s64)))
22056svint64_t svqrdmlah_lane(svint64_t, svint64_t, svint64_t, uint64_t);
22057__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlah_lane_s16)))
22058svint16_t svqrdmlah_lane(svint16_t, svint16_t, svint16_t, uint64_t);
22059__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_n_s8)))
22060svint8_t svqrdmlsh(svint8_t, svint8_t, int8_t);
22061__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_n_s32)))
22062svint32_t svqrdmlsh(svint32_t, svint32_t, int32_t);
22063__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_n_s64)))
22064svint64_t svqrdmlsh(svint64_t, svint64_t, int64_t);
22065__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_n_s16)))
22066svint16_t svqrdmlsh(svint16_t, svint16_t, int16_t);
22067__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_s8)))
22068svint8_t svqrdmlsh(svint8_t, svint8_t, svint8_t);
22069__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_s32)))
22070svint32_t svqrdmlsh(svint32_t, svint32_t, svint32_t);
22071__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_s64)))
22072svint64_t svqrdmlsh(svint64_t, svint64_t, svint64_t);
22073__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_s16)))
22074svint16_t svqrdmlsh(svint16_t, svint16_t, svint16_t);
22075__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_lane_s32)))
22076svint32_t svqrdmlsh_lane(svint32_t, svint32_t, svint32_t, uint64_t);
22077__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_lane_s64)))
22078svint64_t svqrdmlsh_lane(svint64_t, svint64_t, svint64_t, uint64_t);
22079__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmlsh_lane_s16)))
22080svint16_t svqrdmlsh_lane(svint16_t, svint16_t, svint16_t, uint64_t);
22081__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_n_s8)))
22082svint8_t svqrdmulh(svint8_t, int8_t);
22083__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_n_s32)))
22084svint32_t svqrdmulh(svint32_t, int32_t);
22085__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_n_s64)))
22086svint64_t svqrdmulh(svint64_t, int64_t);
22087__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_n_s16)))
22088svint16_t svqrdmulh(svint16_t, int16_t);
22089__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_s8)))
22090svint8_t svqrdmulh(svint8_t, svint8_t);
22091__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_s32)))
22092svint32_t svqrdmulh(svint32_t, svint32_t);
22093__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_s64)))
22094svint64_t svqrdmulh(svint64_t, svint64_t);
22095__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_s16)))
22096svint16_t svqrdmulh(svint16_t, svint16_t);
22097__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_lane_s32)))
22098svint32_t svqrdmulh_lane(svint32_t, svint32_t, uint64_t);
22099__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_lane_s64)))
22100svint64_t svqrdmulh_lane(svint64_t, svint64_t, uint64_t);
22101__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrdmulh_lane_s16)))
22102svint16_t svqrdmulh_lane(svint16_t, svint16_t, uint64_t);
22103__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s8_m)))
22104svint8_t svqrshl_m(svbool_t, svint8_t, int8_t);
22105__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s32_m)))
22106svint32_t svqrshl_m(svbool_t, svint32_t, int32_t);
22107__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s64_m)))
22108svint64_t svqrshl_m(svbool_t, svint64_t, int64_t);
22109__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s16_m)))
22110svint16_t svqrshl_m(svbool_t, svint16_t, int16_t);
22111__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s8_x)))
22112svint8_t svqrshl_x(svbool_t, svint8_t, int8_t);
22113__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s32_x)))
22114svint32_t svqrshl_x(svbool_t, svint32_t, int32_t);
22115__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s64_x)))
22116svint64_t svqrshl_x(svbool_t, svint64_t, int64_t);
22117__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s16_x)))
22118svint16_t svqrshl_x(svbool_t, svint16_t, int16_t);
22119__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s8_z)))
22120svint8_t svqrshl_z(svbool_t, svint8_t, int8_t);
22121__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s32_z)))
22122svint32_t svqrshl_z(svbool_t, svint32_t, int32_t);
22123__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s64_z)))
22124svint64_t svqrshl_z(svbool_t, svint64_t, int64_t);
22125__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_s16_z)))
22126svint16_t svqrshl_z(svbool_t, svint16_t, int16_t);
22127__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u8_m)))
22128svuint8_t svqrshl_m(svbool_t, svuint8_t, int8_t);
22129__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u32_m)))
22130svuint32_t svqrshl_m(svbool_t, svuint32_t, int32_t);
22131__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u64_m)))
22132svuint64_t svqrshl_m(svbool_t, svuint64_t, int64_t);
22133__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u16_m)))
22134svuint16_t svqrshl_m(svbool_t, svuint16_t, int16_t);
22135__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u8_x)))
22136svuint8_t svqrshl_x(svbool_t, svuint8_t, int8_t);
22137__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u32_x)))
22138svuint32_t svqrshl_x(svbool_t, svuint32_t, int32_t);
22139__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u64_x)))
22140svuint64_t svqrshl_x(svbool_t, svuint64_t, int64_t);
22141__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u16_x)))
22142svuint16_t svqrshl_x(svbool_t, svuint16_t, int16_t);
22143__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u8_z)))
22144svuint8_t svqrshl_z(svbool_t, svuint8_t, int8_t);
22145__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u32_z)))
22146svuint32_t svqrshl_z(svbool_t, svuint32_t, int32_t);
22147__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u64_z)))
22148svuint64_t svqrshl_z(svbool_t, svuint64_t, int64_t);
22149__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_n_u16_z)))
22150svuint16_t svqrshl_z(svbool_t, svuint16_t, int16_t);
22151__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s8_m)))
22152svint8_t svqrshl_m(svbool_t, svint8_t, svint8_t);
22153__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s32_m)))
22154svint32_t svqrshl_m(svbool_t, svint32_t, svint32_t);
22155__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s64_m)))
22156svint64_t svqrshl_m(svbool_t, svint64_t, svint64_t);
22157__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s16_m)))
22158svint16_t svqrshl_m(svbool_t, svint16_t, svint16_t);
22159__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s8_x)))
22160svint8_t svqrshl_x(svbool_t, svint8_t, svint8_t);
22161__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s32_x)))
22162svint32_t svqrshl_x(svbool_t, svint32_t, svint32_t);
22163__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s64_x)))
22164svint64_t svqrshl_x(svbool_t, svint64_t, svint64_t);
22165__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s16_x)))
22166svint16_t svqrshl_x(svbool_t, svint16_t, svint16_t);
22167__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s8_z)))
22168svint8_t svqrshl_z(svbool_t, svint8_t, svint8_t);
22169__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s32_z)))
22170svint32_t svqrshl_z(svbool_t, svint32_t, svint32_t);
22171__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s64_z)))
22172svint64_t svqrshl_z(svbool_t, svint64_t, svint64_t);
22173__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_s16_z)))
22174svint16_t svqrshl_z(svbool_t, svint16_t, svint16_t);
22175__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u8_m)))
22176svuint8_t svqrshl_m(svbool_t, svuint8_t, svint8_t);
22177__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u32_m)))
22178svuint32_t svqrshl_m(svbool_t, svuint32_t, svint32_t);
22179__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u64_m)))
22180svuint64_t svqrshl_m(svbool_t, svuint64_t, svint64_t);
22181__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u16_m)))
22182svuint16_t svqrshl_m(svbool_t, svuint16_t, svint16_t);
22183__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u8_x)))
22184svuint8_t svqrshl_x(svbool_t, svuint8_t, svint8_t);
22185__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u32_x)))
22186svuint32_t svqrshl_x(svbool_t, svuint32_t, svint32_t);
22187__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u64_x)))
22188svuint64_t svqrshl_x(svbool_t, svuint64_t, svint64_t);
22189__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u16_x)))
22190svuint16_t svqrshl_x(svbool_t, svuint16_t, svint16_t);
22191__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u8_z)))
22192svuint8_t svqrshl_z(svbool_t, svuint8_t, svint8_t);
22193__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u32_z)))
22194svuint32_t svqrshl_z(svbool_t, svuint32_t, svint32_t);
22195__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u64_z)))
22196svuint64_t svqrshl_z(svbool_t, svuint64_t, svint64_t);
22197__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshl_u16_z)))
22198svuint16_t svqrshl_z(svbool_t, svuint16_t, svint16_t);
22199__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnb_n_s32)))
22200svint16_t svqrshrnb(svint32_t, uint64_t);
22201__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnb_n_s64)))
22202svint32_t svqrshrnb(svint64_t, uint64_t);
22203__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnb_n_s16)))
22204svint8_t svqrshrnb(svint16_t, uint64_t);
22205__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnb_n_u32)))
22206svuint16_t svqrshrnb(svuint32_t, uint64_t);
22207__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnb_n_u64)))
22208svuint32_t svqrshrnb(svuint64_t, uint64_t);
22209__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnb_n_u16)))
22210svuint8_t svqrshrnb(svuint16_t, uint64_t);
22211__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnt_n_s32)))
22212svint16_t svqrshrnt(svint16_t, svint32_t, uint64_t);
22213__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnt_n_s64)))
22214svint32_t svqrshrnt(svint32_t, svint64_t, uint64_t);
22215__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnt_n_s16)))
22216svint8_t svqrshrnt(svint8_t, svint16_t, uint64_t);
22217__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnt_n_u32)))
22218svuint16_t svqrshrnt(svuint16_t, svuint32_t, uint64_t);
22219__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnt_n_u64)))
22220svuint32_t svqrshrnt(svuint32_t, svuint64_t, uint64_t);
22221__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrnt_n_u16)))
22222svuint8_t svqrshrnt(svuint8_t, svuint16_t, uint64_t);
22223__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrunb_n_s32)))
22224svuint16_t svqrshrunb(svint32_t, uint64_t);
22225__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrunb_n_s64)))
22226svuint32_t svqrshrunb(svint64_t, uint64_t);
22227__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrunb_n_s16)))
22228svuint8_t svqrshrunb(svint16_t, uint64_t);
22229__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrunt_n_s32)))
22230svuint16_t svqrshrunt(svuint16_t, svint32_t, uint64_t);
22231__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrunt_n_s64)))
22232svuint32_t svqrshrunt(svuint32_t, svint64_t, uint64_t);
22233__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqrshrunt_n_s16)))
22234svuint8_t svqrshrunt(svuint8_t, svint16_t, uint64_t);
22235__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s8_m)))
22236svint8_t svqshl_m(svbool_t, svint8_t, int8_t);
22237__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s32_m)))
22238svint32_t svqshl_m(svbool_t, svint32_t, int32_t);
22239__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s64_m)))
22240svint64_t svqshl_m(svbool_t, svint64_t, int64_t);
22241__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s16_m)))
22242svint16_t svqshl_m(svbool_t, svint16_t, int16_t);
22243__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s8_x)))
22244svint8_t svqshl_x(svbool_t, svint8_t, int8_t);
22245__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s32_x)))
22246svint32_t svqshl_x(svbool_t, svint32_t, int32_t);
22247__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s64_x)))
22248svint64_t svqshl_x(svbool_t, svint64_t, int64_t);
22249__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s16_x)))
22250svint16_t svqshl_x(svbool_t, svint16_t, int16_t);
22251__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s8_z)))
22252svint8_t svqshl_z(svbool_t, svint8_t, int8_t);
22253__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s32_z)))
22254svint32_t svqshl_z(svbool_t, svint32_t, int32_t);
22255__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s64_z)))
22256svint64_t svqshl_z(svbool_t, svint64_t, int64_t);
22257__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_s16_z)))
22258svint16_t svqshl_z(svbool_t, svint16_t, int16_t);
22259__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u8_m)))
22260svuint8_t svqshl_m(svbool_t, svuint8_t, int8_t);
22261__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u32_m)))
22262svuint32_t svqshl_m(svbool_t, svuint32_t, int32_t);
22263__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u64_m)))
22264svuint64_t svqshl_m(svbool_t, svuint64_t, int64_t);
22265__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u16_m)))
22266svuint16_t svqshl_m(svbool_t, svuint16_t, int16_t);
22267__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u8_x)))
22268svuint8_t svqshl_x(svbool_t, svuint8_t, int8_t);
22269__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u32_x)))
22270svuint32_t svqshl_x(svbool_t, svuint32_t, int32_t);
22271__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u64_x)))
22272svuint64_t svqshl_x(svbool_t, svuint64_t, int64_t);
22273__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u16_x)))
22274svuint16_t svqshl_x(svbool_t, svuint16_t, int16_t);
22275__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u8_z)))
22276svuint8_t svqshl_z(svbool_t, svuint8_t, int8_t);
22277__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u32_z)))
22278svuint32_t svqshl_z(svbool_t, svuint32_t, int32_t);
22279__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u64_z)))
22280svuint64_t svqshl_z(svbool_t, svuint64_t, int64_t);
22281__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_n_u16_z)))
22282svuint16_t svqshl_z(svbool_t, svuint16_t, int16_t);
22283__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s8_m)))
22284svint8_t svqshl_m(svbool_t, svint8_t, svint8_t);
22285__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s32_m)))
22286svint32_t svqshl_m(svbool_t, svint32_t, svint32_t);
22287__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s64_m)))
22288svint64_t svqshl_m(svbool_t, svint64_t, svint64_t);
22289__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s16_m)))
22290svint16_t svqshl_m(svbool_t, svint16_t, svint16_t);
22291__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s8_x)))
22292svint8_t svqshl_x(svbool_t, svint8_t, svint8_t);
22293__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s32_x)))
22294svint32_t svqshl_x(svbool_t, svint32_t, svint32_t);
22295__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s64_x)))
22296svint64_t svqshl_x(svbool_t, svint64_t, svint64_t);
22297__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s16_x)))
22298svint16_t svqshl_x(svbool_t, svint16_t, svint16_t);
22299__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s8_z)))
22300svint8_t svqshl_z(svbool_t, svint8_t, svint8_t);
22301__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s32_z)))
22302svint32_t svqshl_z(svbool_t, svint32_t, svint32_t);
22303__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s64_z)))
22304svint64_t svqshl_z(svbool_t, svint64_t, svint64_t);
22305__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_s16_z)))
22306svint16_t svqshl_z(svbool_t, svint16_t, svint16_t);
22307__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u8_m)))
22308svuint8_t svqshl_m(svbool_t, svuint8_t, svint8_t);
22309__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u32_m)))
22310svuint32_t svqshl_m(svbool_t, svuint32_t, svint32_t);
22311__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u64_m)))
22312svuint64_t svqshl_m(svbool_t, svuint64_t, svint64_t);
22313__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u16_m)))
22314svuint16_t svqshl_m(svbool_t, svuint16_t, svint16_t);
22315__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u8_x)))
22316svuint8_t svqshl_x(svbool_t, svuint8_t, svint8_t);
22317__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u32_x)))
22318svuint32_t svqshl_x(svbool_t, svuint32_t, svint32_t);
22319__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u64_x)))
22320svuint64_t svqshl_x(svbool_t, svuint64_t, svint64_t);
22321__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u16_x)))
22322svuint16_t svqshl_x(svbool_t, svuint16_t, svint16_t);
22323__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u8_z)))
22324svuint8_t svqshl_z(svbool_t, svuint8_t, svint8_t);
22325__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u32_z)))
22326svuint32_t svqshl_z(svbool_t, svuint32_t, svint32_t);
22327__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u64_z)))
22328svuint64_t svqshl_z(svbool_t, svuint64_t, svint64_t);
22329__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshl_u16_z)))
22330svuint16_t svqshl_z(svbool_t, svuint16_t, svint16_t);
22331__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s8_m)))
22332svuint8_t svqshlu_m(svbool_t, svint8_t, uint64_t);
22333__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s32_m)))
22334svuint32_t svqshlu_m(svbool_t, svint32_t, uint64_t);
22335__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s64_m)))
22336svuint64_t svqshlu_m(svbool_t, svint64_t, uint64_t);
22337__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s16_m)))
22338svuint16_t svqshlu_m(svbool_t, svint16_t, uint64_t);
22339__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s8_x)))
22340svuint8_t svqshlu_x(svbool_t, svint8_t, uint64_t);
22341__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s32_x)))
22342svuint32_t svqshlu_x(svbool_t, svint32_t, uint64_t);
22343__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s64_x)))
22344svuint64_t svqshlu_x(svbool_t, svint64_t, uint64_t);
22345__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s16_x)))
22346svuint16_t svqshlu_x(svbool_t, svint16_t, uint64_t);
22347__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s8_z)))
22348svuint8_t svqshlu_z(svbool_t, svint8_t, uint64_t);
22349__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s32_z)))
22350svuint32_t svqshlu_z(svbool_t, svint32_t, uint64_t);
22351__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s64_z)))
22352svuint64_t svqshlu_z(svbool_t, svint64_t, uint64_t);
22353__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshlu_n_s16_z)))
22354svuint16_t svqshlu_z(svbool_t, svint16_t, uint64_t);
22355__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnb_n_s32)))
22356svint16_t svqshrnb(svint32_t, uint64_t);
22357__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnb_n_s64)))
22358svint32_t svqshrnb(svint64_t, uint64_t);
22359__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnb_n_s16)))
22360svint8_t svqshrnb(svint16_t, uint64_t);
22361__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnb_n_u32)))
22362svuint16_t svqshrnb(svuint32_t, uint64_t);
22363__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnb_n_u64)))
22364svuint32_t svqshrnb(svuint64_t, uint64_t);
22365__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnb_n_u16)))
22366svuint8_t svqshrnb(svuint16_t, uint64_t);
22367__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnt_n_s32)))
22368svint16_t svqshrnt(svint16_t, svint32_t, uint64_t);
22369__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnt_n_s64)))
22370svint32_t svqshrnt(svint32_t, svint64_t, uint64_t);
22371__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnt_n_s16)))
22372svint8_t svqshrnt(svint8_t, svint16_t, uint64_t);
22373__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnt_n_u32)))
22374svuint16_t svqshrnt(svuint16_t, svuint32_t, uint64_t);
22375__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnt_n_u64)))
22376svuint32_t svqshrnt(svuint32_t, svuint64_t, uint64_t);
22377__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrnt_n_u16)))
22378svuint8_t svqshrnt(svuint8_t, svuint16_t, uint64_t);
22379__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrunb_n_s32)))
22380svuint16_t svqshrunb(svint32_t, uint64_t);
22381__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrunb_n_s64)))
22382svuint32_t svqshrunb(svint64_t, uint64_t);
22383__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrunb_n_s16)))
22384svuint8_t svqshrunb(svint16_t, uint64_t);
22385__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrunt_n_s32)))
22386svuint16_t svqshrunt(svuint16_t, svint32_t, uint64_t);
22387__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrunt_n_s64)))
22388svuint32_t svqshrunt(svuint32_t, svint64_t, uint64_t);
22389__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqshrunt_n_s16)))
22390svuint8_t svqshrunt(svuint8_t, svint16_t, uint64_t);
22391__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s8_m)))
22392svint8_t svqsub_m(svbool_t, svint8_t, int8_t);
22393__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s32_m)))
22394svint32_t svqsub_m(svbool_t, svint32_t, int32_t);
22395__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s64_m)))
22396svint64_t svqsub_m(svbool_t, svint64_t, int64_t);
22397__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s16_m)))
22398svint16_t svqsub_m(svbool_t, svint16_t, int16_t);
22399__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s8_x)))
22400svint8_t svqsub_x(svbool_t, svint8_t, int8_t);
22401__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s32_x)))
22402svint32_t svqsub_x(svbool_t, svint32_t, int32_t);
22403__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s64_x)))
22404svint64_t svqsub_x(svbool_t, svint64_t, int64_t);
22405__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s16_x)))
22406svint16_t svqsub_x(svbool_t, svint16_t, int16_t);
22407__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s8_z)))
22408svint8_t svqsub_z(svbool_t, svint8_t, int8_t);
22409__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s32_z)))
22410svint32_t svqsub_z(svbool_t, svint32_t, int32_t);
22411__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s64_z)))
22412svint64_t svqsub_z(svbool_t, svint64_t, int64_t);
22413__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_s16_z)))
22414svint16_t svqsub_z(svbool_t, svint16_t, int16_t);
22415__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u8_m)))
22416svuint8_t svqsub_m(svbool_t, svuint8_t, uint8_t);
22417__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u32_m)))
22418svuint32_t svqsub_m(svbool_t, svuint32_t, uint32_t);
22419__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u64_m)))
22420svuint64_t svqsub_m(svbool_t, svuint64_t, uint64_t);
22421__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u16_m)))
22422svuint16_t svqsub_m(svbool_t, svuint16_t, uint16_t);
22423__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u8_x)))
22424svuint8_t svqsub_x(svbool_t, svuint8_t, uint8_t);
22425__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u32_x)))
22426svuint32_t svqsub_x(svbool_t, svuint32_t, uint32_t);
22427__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u64_x)))
22428svuint64_t svqsub_x(svbool_t, svuint64_t, uint64_t);
22429__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u16_x)))
22430svuint16_t svqsub_x(svbool_t, svuint16_t, uint16_t);
22431__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u8_z)))
22432svuint8_t svqsub_z(svbool_t, svuint8_t, uint8_t);
22433__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u32_z)))
22434svuint32_t svqsub_z(svbool_t, svuint32_t, uint32_t);
22435__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u64_z)))
22436svuint64_t svqsub_z(svbool_t, svuint64_t, uint64_t);
22437__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_n_u16_z)))
22438svuint16_t svqsub_z(svbool_t, svuint16_t, uint16_t);
22439__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s8_m)))
22440svint8_t svqsub_m(svbool_t, svint8_t, svint8_t);
22441__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s32_m)))
22442svint32_t svqsub_m(svbool_t, svint32_t, svint32_t);
22443__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s64_m)))
22444svint64_t svqsub_m(svbool_t, svint64_t, svint64_t);
22445__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s16_m)))
22446svint16_t svqsub_m(svbool_t, svint16_t, svint16_t);
22447__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s8_x)))
22448svint8_t svqsub_x(svbool_t, svint8_t, svint8_t);
22449__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s32_x)))
22450svint32_t svqsub_x(svbool_t, svint32_t, svint32_t);
22451__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s64_x)))
22452svint64_t svqsub_x(svbool_t, svint64_t, svint64_t);
22453__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s16_x)))
22454svint16_t svqsub_x(svbool_t, svint16_t, svint16_t);
22455__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s8_z)))
22456svint8_t svqsub_z(svbool_t, svint8_t, svint8_t);
22457__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s32_z)))
22458svint32_t svqsub_z(svbool_t, svint32_t, svint32_t);
22459__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s64_z)))
22460svint64_t svqsub_z(svbool_t, svint64_t, svint64_t);
22461__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_s16_z)))
22462svint16_t svqsub_z(svbool_t, svint16_t, svint16_t);
22463__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u8_m)))
22464svuint8_t svqsub_m(svbool_t, svuint8_t, svuint8_t);
22465__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u32_m)))
22466svuint32_t svqsub_m(svbool_t, svuint32_t, svuint32_t);
22467__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u64_m)))
22468svuint64_t svqsub_m(svbool_t, svuint64_t, svuint64_t);
22469__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u16_m)))
22470svuint16_t svqsub_m(svbool_t, svuint16_t, svuint16_t);
22471__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u8_x)))
22472svuint8_t svqsub_x(svbool_t, svuint8_t, svuint8_t);
22473__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u32_x)))
22474svuint32_t svqsub_x(svbool_t, svuint32_t, svuint32_t);
22475__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u64_x)))
22476svuint64_t svqsub_x(svbool_t, svuint64_t, svuint64_t);
22477__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u16_x)))
22478svuint16_t svqsub_x(svbool_t, svuint16_t, svuint16_t);
22479__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u8_z)))
22480svuint8_t svqsub_z(svbool_t, svuint8_t, svuint8_t);
22481__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u32_z)))
22482svuint32_t svqsub_z(svbool_t, svuint32_t, svuint32_t);
22483__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u64_z)))
22484svuint64_t svqsub_z(svbool_t, svuint64_t, svuint64_t);
22485__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsub_u16_z)))
22486svuint16_t svqsub_z(svbool_t, svuint16_t, svuint16_t);
22487__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s8_m)))
22488svint8_t svqsubr_m(svbool_t, svint8_t, int8_t);
22489__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s32_m)))
22490svint32_t svqsubr_m(svbool_t, svint32_t, int32_t);
22491__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s64_m)))
22492svint64_t svqsubr_m(svbool_t, svint64_t, int64_t);
22493__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s16_m)))
22494svint16_t svqsubr_m(svbool_t, svint16_t, int16_t);
22495__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s8_x)))
22496svint8_t svqsubr_x(svbool_t, svint8_t, int8_t);
22497__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s32_x)))
22498svint32_t svqsubr_x(svbool_t, svint32_t, int32_t);
22499__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s64_x)))
22500svint64_t svqsubr_x(svbool_t, svint64_t, int64_t);
22501__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s16_x)))
22502svint16_t svqsubr_x(svbool_t, svint16_t, int16_t);
22503__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s8_z)))
22504svint8_t svqsubr_z(svbool_t, svint8_t, int8_t);
22505__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s32_z)))
22506svint32_t svqsubr_z(svbool_t, svint32_t, int32_t);
22507__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s64_z)))
22508svint64_t svqsubr_z(svbool_t, svint64_t, int64_t);
22509__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_s16_z)))
22510svint16_t svqsubr_z(svbool_t, svint16_t, int16_t);
22511__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u8_m)))
22512svuint8_t svqsubr_m(svbool_t, svuint8_t, uint8_t);
22513__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u32_m)))
22514svuint32_t svqsubr_m(svbool_t, svuint32_t, uint32_t);
22515__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u64_m)))
22516svuint64_t svqsubr_m(svbool_t, svuint64_t, uint64_t);
22517__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u16_m)))
22518svuint16_t svqsubr_m(svbool_t, svuint16_t, uint16_t);
22519__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u8_x)))
22520svuint8_t svqsubr_x(svbool_t, svuint8_t, uint8_t);
22521__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u32_x)))
22522svuint32_t svqsubr_x(svbool_t, svuint32_t, uint32_t);
22523__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u64_x)))
22524svuint64_t svqsubr_x(svbool_t, svuint64_t, uint64_t);
22525__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u16_x)))
22526svuint16_t svqsubr_x(svbool_t, svuint16_t, uint16_t);
22527__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u8_z)))
22528svuint8_t svqsubr_z(svbool_t, svuint8_t, uint8_t);
22529__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u32_z)))
22530svuint32_t svqsubr_z(svbool_t, svuint32_t, uint32_t);
22531__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u64_z)))
22532svuint64_t svqsubr_z(svbool_t, svuint64_t, uint64_t);
22533__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_n_u16_z)))
22534svuint16_t svqsubr_z(svbool_t, svuint16_t, uint16_t);
22535__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s8_m)))
22536svint8_t svqsubr_m(svbool_t, svint8_t, svint8_t);
22537__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s32_m)))
22538svint32_t svqsubr_m(svbool_t, svint32_t, svint32_t);
22539__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s64_m)))
22540svint64_t svqsubr_m(svbool_t, svint64_t, svint64_t);
22541__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s16_m)))
22542svint16_t svqsubr_m(svbool_t, svint16_t, svint16_t);
22543__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s8_x)))
22544svint8_t svqsubr_x(svbool_t, svint8_t, svint8_t);
22545__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s32_x)))
22546svint32_t svqsubr_x(svbool_t, svint32_t, svint32_t);
22547__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s64_x)))
22548svint64_t svqsubr_x(svbool_t, svint64_t, svint64_t);
22549__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s16_x)))
22550svint16_t svqsubr_x(svbool_t, svint16_t, svint16_t);
22551__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s8_z)))
22552svint8_t svqsubr_z(svbool_t, svint8_t, svint8_t);
22553__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s32_z)))
22554svint32_t svqsubr_z(svbool_t, svint32_t, svint32_t);
22555__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s64_z)))
22556svint64_t svqsubr_z(svbool_t, svint64_t, svint64_t);
22557__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_s16_z)))
22558svint16_t svqsubr_z(svbool_t, svint16_t, svint16_t);
22559__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u8_m)))
22560svuint8_t svqsubr_m(svbool_t, svuint8_t, svuint8_t);
22561__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u32_m)))
22562svuint32_t svqsubr_m(svbool_t, svuint32_t, svuint32_t);
22563__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u64_m)))
22564svuint64_t svqsubr_m(svbool_t, svuint64_t, svuint64_t);
22565__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u16_m)))
22566svuint16_t svqsubr_m(svbool_t, svuint16_t, svuint16_t);
22567__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u8_x)))
22568svuint8_t svqsubr_x(svbool_t, svuint8_t, svuint8_t);
22569__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u32_x)))
22570svuint32_t svqsubr_x(svbool_t, svuint32_t, svuint32_t);
22571__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u64_x)))
22572svuint64_t svqsubr_x(svbool_t, svuint64_t, svuint64_t);
22573__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u16_x)))
22574svuint16_t svqsubr_x(svbool_t, svuint16_t, svuint16_t);
22575__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u8_z)))
22576svuint8_t svqsubr_z(svbool_t, svuint8_t, svuint8_t);
22577__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u32_z)))
22578svuint32_t svqsubr_z(svbool_t, svuint32_t, svuint32_t);
22579__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u64_z)))
22580svuint64_t svqsubr_z(svbool_t, svuint64_t, svuint64_t);
22581__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqsubr_u16_z)))
22582svuint16_t svqsubr_z(svbool_t, svuint16_t, svuint16_t);
22583__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnb_s32)))
22584svint16_t svqxtnb(svint32_t);
22585__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnb_s64)))
22586svint32_t svqxtnb(svint64_t);
22587__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnb_s16)))
22588svint8_t svqxtnb(svint16_t);
22589__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnb_u32)))
22590svuint16_t svqxtnb(svuint32_t);
22591__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnb_u64)))
22592svuint32_t svqxtnb(svuint64_t);
22593__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnb_u16)))
22594svuint8_t svqxtnb(svuint16_t);
22595__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnt_s32)))
22596svint16_t svqxtnt(svint16_t, svint32_t);
22597__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnt_s64)))
22598svint32_t svqxtnt(svint32_t, svint64_t);
22599__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnt_s16)))
22600svint8_t svqxtnt(svint8_t, svint16_t);
22601__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnt_u32)))
22602svuint16_t svqxtnt(svuint16_t, svuint32_t);
22603__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnt_u64)))
22604svuint32_t svqxtnt(svuint32_t, svuint64_t);
22605__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtnt_u16)))
22606svuint8_t svqxtnt(svuint8_t, svuint16_t);
22607__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtunb_s32)))
22608svuint16_t svqxtunb(svint32_t);
22609__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtunb_s64)))
22610svuint32_t svqxtunb(svint64_t);
22611__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtunb_s16)))
22612svuint8_t svqxtunb(svint16_t);
22613__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtunt_s32)))
22614svuint16_t svqxtunt(svuint16_t, svint32_t);
22615__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtunt_s64)))
22616svuint32_t svqxtunt(svuint32_t, svint64_t);
22617__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svqxtunt_s16)))
22618svuint8_t svqxtunt(svuint8_t, svint16_t);
22619__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_n_u32)))
22620svuint16_t svraddhnb(svuint32_t, uint32_t);
22621__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_n_u64)))
22622svuint32_t svraddhnb(svuint64_t, uint64_t);
22623__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_n_u16)))
22624svuint8_t svraddhnb(svuint16_t, uint16_t);
22625__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_n_s32)))
22626svint16_t svraddhnb(svint32_t, int32_t);
22627__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_n_s64)))
22628svint32_t svraddhnb(svint64_t, int64_t);
22629__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_n_s16)))
22630svint8_t svraddhnb(svint16_t, int16_t);
22631__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_u32)))
22632svuint16_t svraddhnb(svuint32_t, svuint32_t);
22633__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_u64)))
22634svuint32_t svraddhnb(svuint64_t, svuint64_t);
22635__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_u16)))
22636svuint8_t svraddhnb(svuint16_t, svuint16_t);
22637__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_s32)))
22638svint16_t svraddhnb(svint32_t, svint32_t);
22639__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_s64)))
22640svint32_t svraddhnb(svint64_t, svint64_t);
22641__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnb_s16)))
22642svint8_t svraddhnb(svint16_t, svint16_t);
22643__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_n_u32)))
22644svuint16_t svraddhnt(svuint16_t, svuint32_t, uint32_t);
22645__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_n_u64)))
22646svuint32_t svraddhnt(svuint32_t, svuint64_t, uint64_t);
22647__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_n_u16)))
22648svuint8_t svraddhnt(svuint8_t, svuint16_t, uint16_t);
22649__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_n_s32)))
22650svint16_t svraddhnt(svint16_t, svint32_t, int32_t);
22651__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_n_s64)))
22652svint32_t svraddhnt(svint32_t, svint64_t, int64_t);
22653__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_n_s16)))
22654svint8_t svraddhnt(svint8_t, svint16_t, int16_t);
22655__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_u32)))
22656svuint16_t svraddhnt(svuint16_t, svuint32_t, svuint32_t);
22657__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_u64)))
22658svuint32_t svraddhnt(svuint32_t, svuint64_t, svuint64_t);
22659__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_u16)))
22660svuint8_t svraddhnt(svuint8_t, svuint16_t, svuint16_t);
22661__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_s32)))
22662svint16_t svraddhnt(svint16_t, svint32_t, svint32_t);
22663__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_s64)))
22664svint32_t svraddhnt(svint32_t, svint64_t, svint64_t);
22665__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svraddhnt_s16)))
22666svint8_t svraddhnt(svint8_t, svint16_t, svint16_t);
22667__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrecpe_u32_m)))
22668svuint32_t svrecpe_m(svuint32_t, svbool_t, svuint32_t);
22669__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrecpe_u32_x)))
22670svuint32_t svrecpe_x(svbool_t, svuint32_t);
22671__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrecpe_u32_z)))
22672svuint32_t svrecpe_z(svbool_t, svuint32_t);
22673__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s8_m)))
22674svint8_t svrhadd_m(svbool_t, svint8_t, int8_t);
22675__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s32_m)))
22676svint32_t svrhadd_m(svbool_t, svint32_t, int32_t);
22677__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s64_m)))
22678svint64_t svrhadd_m(svbool_t, svint64_t, int64_t);
22679__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s16_m)))
22680svint16_t svrhadd_m(svbool_t, svint16_t, int16_t);
22681__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s8_x)))
22682svint8_t svrhadd_x(svbool_t, svint8_t, int8_t);
22683__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s32_x)))
22684svint32_t svrhadd_x(svbool_t, svint32_t, int32_t);
22685__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s64_x)))
22686svint64_t svrhadd_x(svbool_t, svint64_t, int64_t);
22687__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s16_x)))
22688svint16_t svrhadd_x(svbool_t, svint16_t, int16_t);
22689__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s8_z)))
22690svint8_t svrhadd_z(svbool_t, svint8_t, int8_t);
22691__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s32_z)))
22692svint32_t svrhadd_z(svbool_t, svint32_t, int32_t);
22693__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s64_z)))
22694svint64_t svrhadd_z(svbool_t, svint64_t, int64_t);
22695__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_s16_z)))
22696svint16_t svrhadd_z(svbool_t, svint16_t, int16_t);
22697__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u8_m)))
22698svuint8_t svrhadd_m(svbool_t, svuint8_t, uint8_t);
22699__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u32_m)))
22700svuint32_t svrhadd_m(svbool_t, svuint32_t, uint32_t);
22701__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u64_m)))
22702svuint64_t svrhadd_m(svbool_t, svuint64_t, uint64_t);
22703__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u16_m)))
22704svuint16_t svrhadd_m(svbool_t, svuint16_t, uint16_t);
22705__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u8_x)))
22706svuint8_t svrhadd_x(svbool_t, svuint8_t, uint8_t);
22707__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u32_x)))
22708svuint32_t svrhadd_x(svbool_t, svuint32_t, uint32_t);
22709__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u64_x)))
22710svuint64_t svrhadd_x(svbool_t, svuint64_t, uint64_t);
22711__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u16_x)))
22712svuint16_t svrhadd_x(svbool_t, svuint16_t, uint16_t);
22713__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u8_z)))
22714svuint8_t svrhadd_z(svbool_t, svuint8_t, uint8_t);
22715__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u32_z)))
22716svuint32_t svrhadd_z(svbool_t, svuint32_t, uint32_t);
22717__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u64_z)))
22718svuint64_t svrhadd_z(svbool_t, svuint64_t, uint64_t);
22719__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_n_u16_z)))
22720svuint16_t svrhadd_z(svbool_t, svuint16_t, uint16_t);
22721__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s8_m)))
22722svint8_t svrhadd_m(svbool_t, svint8_t, svint8_t);
22723__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s32_m)))
22724svint32_t svrhadd_m(svbool_t, svint32_t, svint32_t);
22725__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s64_m)))
22726svint64_t svrhadd_m(svbool_t, svint64_t, svint64_t);
22727__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s16_m)))
22728svint16_t svrhadd_m(svbool_t, svint16_t, svint16_t);
22729__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s8_x)))
22730svint8_t svrhadd_x(svbool_t, svint8_t, svint8_t);
22731__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s32_x)))
22732svint32_t svrhadd_x(svbool_t, svint32_t, svint32_t);
22733__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s64_x)))
22734svint64_t svrhadd_x(svbool_t, svint64_t, svint64_t);
22735__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s16_x)))
22736svint16_t svrhadd_x(svbool_t, svint16_t, svint16_t);
22737__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s8_z)))
22738svint8_t svrhadd_z(svbool_t, svint8_t, svint8_t);
22739__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s32_z)))
22740svint32_t svrhadd_z(svbool_t, svint32_t, svint32_t);
22741__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s64_z)))
22742svint64_t svrhadd_z(svbool_t, svint64_t, svint64_t);
22743__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_s16_z)))
22744svint16_t svrhadd_z(svbool_t, svint16_t, svint16_t);
22745__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u8_m)))
22746svuint8_t svrhadd_m(svbool_t, svuint8_t, svuint8_t);
22747__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u32_m)))
22748svuint32_t svrhadd_m(svbool_t, svuint32_t, svuint32_t);
22749__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u64_m)))
22750svuint64_t svrhadd_m(svbool_t, svuint64_t, svuint64_t);
22751__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u16_m)))
22752svuint16_t svrhadd_m(svbool_t, svuint16_t, svuint16_t);
22753__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u8_x)))
22754svuint8_t svrhadd_x(svbool_t, svuint8_t, svuint8_t);
22755__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u32_x)))
22756svuint32_t svrhadd_x(svbool_t, svuint32_t, svuint32_t);
22757__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u64_x)))
22758svuint64_t svrhadd_x(svbool_t, svuint64_t, svuint64_t);
22759__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u16_x)))
22760svuint16_t svrhadd_x(svbool_t, svuint16_t, svuint16_t);
22761__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u8_z)))
22762svuint8_t svrhadd_z(svbool_t, svuint8_t, svuint8_t);
22763__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u32_z)))
22764svuint32_t svrhadd_z(svbool_t, svuint32_t, svuint32_t);
22765__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u64_z)))
22766svuint64_t svrhadd_z(svbool_t, svuint64_t, svuint64_t);
22767__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrhadd_u16_z)))
22768svuint16_t svrhadd_z(svbool_t, svuint16_t, svuint16_t);
22769__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s8_m)))
22770svint8_t svrshl_m(svbool_t, svint8_t, int8_t);
22771__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s32_m)))
22772svint32_t svrshl_m(svbool_t, svint32_t, int32_t);
22773__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s64_m)))
22774svint64_t svrshl_m(svbool_t, svint64_t, int64_t);
22775__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s16_m)))
22776svint16_t svrshl_m(svbool_t, svint16_t, int16_t);
22777__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s8_x)))
22778svint8_t svrshl_x(svbool_t, svint8_t, int8_t);
22779__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s32_x)))
22780svint32_t svrshl_x(svbool_t, svint32_t, int32_t);
22781__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s64_x)))
22782svint64_t svrshl_x(svbool_t, svint64_t, int64_t);
22783__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s16_x)))
22784svint16_t svrshl_x(svbool_t, svint16_t, int16_t);
22785__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s8_z)))
22786svint8_t svrshl_z(svbool_t, svint8_t, int8_t);
22787__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s32_z)))
22788svint32_t svrshl_z(svbool_t, svint32_t, int32_t);
22789__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s64_z)))
22790svint64_t svrshl_z(svbool_t, svint64_t, int64_t);
22791__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_s16_z)))
22792svint16_t svrshl_z(svbool_t, svint16_t, int16_t);
22793__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u8_m)))
22794svuint8_t svrshl_m(svbool_t, svuint8_t, int8_t);
22795__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u32_m)))
22796svuint32_t svrshl_m(svbool_t, svuint32_t, int32_t);
22797__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u64_m)))
22798svuint64_t svrshl_m(svbool_t, svuint64_t, int64_t);
22799__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u16_m)))
22800svuint16_t svrshl_m(svbool_t, svuint16_t, int16_t);
22801__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u8_x)))
22802svuint8_t svrshl_x(svbool_t, svuint8_t, int8_t);
22803__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u32_x)))
22804svuint32_t svrshl_x(svbool_t, svuint32_t, int32_t);
22805__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u64_x)))
22806svuint64_t svrshl_x(svbool_t, svuint64_t, int64_t);
22807__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u16_x)))
22808svuint16_t svrshl_x(svbool_t, svuint16_t, int16_t);
22809__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u8_z)))
22810svuint8_t svrshl_z(svbool_t, svuint8_t, int8_t);
22811__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u32_z)))
22812svuint32_t svrshl_z(svbool_t, svuint32_t, int32_t);
22813__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u64_z)))
22814svuint64_t svrshl_z(svbool_t, svuint64_t, int64_t);
22815__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_n_u16_z)))
22816svuint16_t svrshl_z(svbool_t, svuint16_t, int16_t);
22817__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s8_m)))
22818svint8_t svrshl_m(svbool_t, svint8_t, svint8_t);
22819__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s32_m)))
22820svint32_t svrshl_m(svbool_t, svint32_t, svint32_t);
22821__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s64_m)))
22822svint64_t svrshl_m(svbool_t, svint64_t, svint64_t);
22823__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s16_m)))
22824svint16_t svrshl_m(svbool_t, svint16_t, svint16_t);
22825__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s8_x)))
22826svint8_t svrshl_x(svbool_t, svint8_t, svint8_t);
22827__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s32_x)))
22828svint32_t svrshl_x(svbool_t, svint32_t, svint32_t);
22829__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s64_x)))
22830svint64_t svrshl_x(svbool_t, svint64_t, svint64_t);
22831__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s16_x)))
22832svint16_t svrshl_x(svbool_t, svint16_t, svint16_t);
22833__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s8_z)))
22834svint8_t svrshl_z(svbool_t, svint8_t, svint8_t);
22835__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s32_z)))
22836svint32_t svrshl_z(svbool_t, svint32_t, svint32_t);
22837__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s64_z)))
22838svint64_t svrshl_z(svbool_t, svint64_t, svint64_t);
22839__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_s16_z)))
22840svint16_t svrshl_z(svbool_t, svint16_t, svint16_t);
22841__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u8_m)))
22842svuint8_t svrshl_m(svbool_t, svuint8_t, svint8_t);
22843__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u32_m)))
22844svuint32_t svrshl_m(svbool_t, svuint32_t, svint32_t);
22845__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u64_m)))
22846svuint64_t svrshl_m(svbool_t, svuint64_t, svint64_t);
22847__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u16_m)))
22848svuint16_t svrshl_m(svbool_t, svuint16_t, svint16_t);
22849__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u8_x)))
22850svuint8_t svrshl_x(svbool_t, svuint8_t, svint8_t);
22851__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u32_x)))
22852svuint32_t svrshl_x(svbool_t, svuint32_t, svint32_t);
22853__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u64_x)))
22854svuint64_t svrshl_x(svbool_t, svuint64_t, svint64_t);
22855__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u16_x)))
22856svuint16_t svrshl_x(svbool_t, svuint16_t, svint16_t);
22857__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u8_z)))
22858svuint8_t svrshl_z(svbool_t, svuint8_t, svint8_t);
22859__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u32_z)))
22860svuint32_t svrshl_z(svbool_t, svuint32_t, svint32_t);
22861__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u64_z)))
22862svuint64_t svrshl_z(svbool_t, svuint64_t, svint64_t);
22863__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshl_u16_z)))
22864svuint16_t svrshl_z(svbool_t, svuint16_t, svint16_t);
22865__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s8_m)))
22866svint8_t svrshr_m(svbool_t, svint8_t, uint64_t);
22867__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s32_m)))
22868svint32_t svrshr_m(svbool_t, svint32_t, uint64_t);
22869__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s64_m)))
22870svint64_t svrshr_m(svbool_t, svint64_t, uint64_t);
22871__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s16_m)))
22872svint16_t svrshr_m(svbool_t, svint16_t, uint64_t);
22873__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u8_m)))
22874svuint8_t svrshr_m(svbool_t, svuint8_t, uint64_t);
22875__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u32_m)))
22876svuint32_t svrshr_m(svbool_t, svuint32_t, uint64_t);
22877__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u64_m)))
22878svuint64_t svrshr_m(svbool_t, svuint64_t, uint64_t);
22879__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u16_m)))
22880svuint16_t svrshr_m(svbool_t, svuint16_t, uint64_t);
22881__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s8_x)))
22882svint8_t svrshr_x(svbool_t, svint8_t, uint64_t);
22883__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s32_x)))
22884svint32_t svrshr_x(svbool_t, svint32_t, uint64_t);
22885__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s64_x)))
22886svint64_t svrshr_x(svbool_t, svint64_t, uint64_t);
22887__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s16_x)))
22888svint16_t svrshr_x(svbool_t, svint16_t, uint64_t);
22889__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u8_x)))
22890svuint8_t svrshr_x(svbool_t, svuint8_t, uint64_t);
22891__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u32_x)))
22892svuint32_t svrshr_x(svbool_t, svuint32_t, uint64_t);
22893__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u64_x)))
22894svuint64_t svrshr_x(svbool_t, svuint64_t, uint64_t);
22895__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u16_x)))
22896svuint16_t svrshr_x(svbool_t, svuint16_t, uint64_t);
22897__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s8_z)))
22898svint8_t svrshr_z(svbool_t, svint8_t, uint64_t);
22899__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s32_z)))
22900svint32_t svrshr_z(svbool_t, svint32_t, uint64_t);
22901__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s64_z)))
22902svint64_t svrshr_z(svbool_t, svint64_t, uint64_t);
22903__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_s16_z)))
22904svint16_t svrshr_z(svbool_t, svint16_t, uint64_t);
22905__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u8_z)))
22906svuint8_t svrshr_z(svbool_t, svuint8_t, uint64_t);
22907__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u32_z)))
22908svuint32_t svrshr_z(svbool_t, svuint32_t, uint64_t);
22909__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u64_z)))
22910svuint64_t svrshr_z(svbool_t, svuint64_t, uint64_t);
22911__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshr_n_u16_z)))
22912svuint16_t svrshr_z(svbool_t, svuint16_t, uint64_t);
22913__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnb_n_u32)))
22914svuint16_t svrshrnb(svuint32_t, uint64_t);
22915__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnb_n_u64)))
22916svuint32_t svrshrnb(svuint64_t, uint64_t);
22917__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnb_n_u16)))
22918svuint8_t svrshrnb(svuint16_t, uint64_t);
22919__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnb_n_s32)))
22920svint16_t svrshrnb(svint32_t, uint64_t);
22921__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnb_n_s64)))
22922svint32_t svrshrnb(svint64_t, uint64_t);
22923__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnb_n_s16)))
22924svint8_t svrshrnb(svint16_t, uint64_t);
22925__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnt_n_u32)))
22926svuint16_t svrshrnt(svuint16_t, svuint32_t, uint64_t);
22927__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnt_n_u64)))
22928svuint32_t svrshrnt(svuint32_t, svuint64_t, uint64_t);
22929__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnt_n_u16)))
22930svuint8_t svrshrnt(svuint8_t, svuint16_t, uint64_t);
22931__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnt_n_s32)))
22932svint16_t svrshrnt(svint16_t, svint32_t, uint64_t);
22933__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnt_n_s64)))
22934svint32_t svrshrnt(svint32_t, svint64_t, uint64_t);
22935__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrshrnt_n_s16)))
22936svint8_t svrshrnt(svint8_t, svint16_t, uint64_t);
22937__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsqrte_u32_m)))
22938svuint32_t svrsqrte_m(svuint32_t, svbool_t, svuint32_t);
22939__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsqrte_u32_x)))
22940svuint32_t svrsqrte_x(svbool_t, svuint32_t);
22941__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsqrte_u32_z)))
22942svuint32_t svrsqrte_z(svbool_t, svuint32_t);
22943__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_s8)))
22944svint8_t svrsra(svint8_t, svint8_t, uint64_t);
22945__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_s32)))
22946svint32_t svrsra(svint32_t, svint32_t, uint64_t);
22947__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_s64)))
22948svint64_t svrsra(svint64_t, svint64_t, uint64_t);
22949__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_s16)))
22950svint16_t svrsra(svint16_t, svint16_t, uint64_t);
22951__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_u8)))
22952svuint8_t svrsra(svuint8_t, svuint8_t, uint64_t);
22953__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_u32)))
22954svuint32_t svrsra(svuint32_t, svuint32_t, uint64_t);
22955__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_u64)))
22956svuint64_t svrsra(svuint64_t, svuint64_t, uint64_t);
22957__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsra_n_u16)))
22958svuint16_t svrsra(svuint16_t, svuint16_t, uint64_t);
22959__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_n_u32)))
22960svuint16_t svrsubhnb(svuint32_t, uint32_t);
22961__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_n_u64)))
22962svuint32_t svrsubhnb(svuint64_t, uint64_t);
22963__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_n_u16)))
22964svuint8_t svrsubhnb(svuint16_t, uint16_t);
22965__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_n_s32)))
22966svint16_t svrsubhnb(svint32_t, int32_t);
22967__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_n_s64)))
22968svint32_t svrsubhnb(svint64_t, int64_t);
22969__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_n_s16)))
22970svint8_t svrsubhnb(svint16_t, int16_t);
22971__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_u32)))
22972svuint16_t svrsubhnb(svuint32_t, svuint32_t);
22973__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_u64)))
22974svuint32_t svrsubhnb(svuint64_t, svuint64_t);
22975__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_u16)))
22976svuint8_t svrsubhnb(svuint16_t, svuint16_t);
22977__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_s32)))
22978svint16_t svrsubhnb(svint32_t, svint32_t);
22979__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_s64)))
22980svint32_t svrsubhnb(svint64_t, svint64_t);
22981__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnb_s16)))
22982svint8_t svrsubhnb(svint16_t, svint16_t);
22983__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_n_u32)))
22984svuint16_t svrsubhnt(svuint16_t, svuint32_t, uint32_t);
22985__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_n_u64)))
22986svuint32_t svrsubhnt(svuint32_t, svuint64_t, uint64_t);
22987__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_n_u16)))
22988svuint8_t svrsubhnt(svuint8_t, svuint16_t, uint16_t);
22989__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_n_s32)))
22990svint16_t svrsubhnt(svint16_t, svint32_t, int32_t);
22991__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_n_s64)))
22992svint32_t svrsubhnt(svint32_t, svint64_t, int64_t);
22993__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_n_s16)))
22994svint8_t svrsubhnt(svint8_t, svint16_t, int16_t);
22995__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_u32)))
22996svuint16_t svrsubhnt(svuint16_t, svuint32_t, svuint32_t);
22997__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_u64)))
22998svuint32_t svrsubhnt(svuint32_t, svuint64_t, svuint64_t);
22999__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_u16)))
23000svuint8_t svrsubhnt(svuint8_t, svuint16_t, svuint16_t);
23001__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_s32)))
23002svint16_t svrsubhnt(svint16_t, svint32_t, svint32_t);
23003__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_s64)))
23004svint32_t svrsubhnt(svint32_t, svint64_t, svint64_t);
23005__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrsubhnt_s16)))
23006svint8_t svrsubhnt(svint8_t, svint16_t, svint16_t);
23007__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclb_n_u32)))
23008svuint32_t svsbclb(svuint32_t, svuint32_t, uint32_t);
23009__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclb_n_u64)))
23010svuint64_t svsbclb(svuint64_t, svuint64_t, uint64_t);
23011__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclb_u32)))
23012svuint32_t svsbclb(svuint32_t, svuint32_t, svuint32_t);
23013__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclb_u64)))
23014svuint64_t svsbclb(svuint64_t, svuint64_t, svuint64_t);
23015__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclt_n_u32)))
23016svuint32_t svsbclt(svuint32_t, svuint32_t, uint32_t);
23017__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclt_n_u64)))
23018svuint64_t svsbclt(svuint64_t, svuint64_t, uint64_t);
23019__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclt_u32)))
23020svuint32_t svsbclt(svuint32_t, svuint32_t, svuint32_t);
23021__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsbclt_u64)))
23022svuint64_t svsbclt(svuint64_t, svuint64_t, svuint64_t);
23023__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllb_n_s32)))
23024svint32_t svshllb(svint16_t, uint64_t);
23025__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllb_n_s64)))
23026svint64_t svshllb(svint32_t, uint64_t);
23027__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllb_n_s16)))
23028svint16_t svshllb(svint8_t, uint64_t);
23029__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllb_n_u32)))
23030svuint32_t svshllb(svuint16_t, uint64_t);
23031__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllb_n_u64)))
23032svuint64_t svshllb(svuint32_t, uint64_t);
23033__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllb_n_u16)))
23034svuint16_t svshllb(svuint8_t, uint64_t);
23035__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllt_n_s32)))
23036svint32_t svshllt(svint16_t, uint64_t);
23037__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllt_n_s64)))
23038svint64_t svshllt(svint32_t, uint64_t);
23039__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllt_n_s16)))
23040svint16_t svshllt(svint8_t, uint64_t);
23041__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllt_n_u32)))
23042svuint32_t svshllt(svuint16_t, uint64_t);
23043__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllt_n_u64)))
23044svuint64_t svshllt(svuint32_t, uint64_t);
23045__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshllt_n_u16)))
23046svuint16_t svshllt(svuint8_t, uint64_t);
23047__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnb_n_u32)))
23048svuint16_t svshrnb(svuint32_t, uint64_t);
23049__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnb_n_u64)))
23050svuint32_t svshrnb(svuint64_t, uint64_t);
23051__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnb_n_u16)))
23052svuint8_t svshrnb(svuint16_t, uint64_t);
23053__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnb_n_s32)))
23054svint16_t svshrnb(svint32_t, uint64_t);
23055__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnb_n_s64)))
23056svint32_t svshrnb(svint64_t, uint64_t);
23057__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnb_n_s16)))
23058svint8_t svshrnb(svint16_t, uint64_t);
23059__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnt_n_u32)))
23060svuint16_t svshrnt(svuint16_t, svuint32_t, uint64_t);
23061__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnt_n_u64)))
23062svuint32_t svshrnt(svuint32_t, svuint64_t, uint64_t);
23063__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnt_n_u16)))
23064svuint8_t svshrnt(svuint8_t, svuint16_t, uint64_t);
23065__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnt_n_s32)))
23066svint16_t svshrnt(svint16_t, svint32_t, uint64_t);
23067__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnt_n_s64)))
23068svint32_t svshrnt(svint32_t, svint64_t, uint64_t);
23069__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svshrnt_n_s16)))
23070svint8_t svshrnt(svint8_t, svint16_t, uint64_t);
23071__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_u8)))
23072svuint8_t svsli(svuint8_t, svuint8_t, uint64_t);
23073__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_u32)))
23074svuint32_t svsli(svuint32_t, svuint32_t, uint64_t);
23075__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_u64)))
23076svuint64_t svsli(svuint64_t, svuint64_t, uint64_t);
23077__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_u16)))
23078svuint16_t svsli(svuint16_t, svuint16_t, uint64_t);
23079__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_s8)))
23080svint8_t svsli(svint8_t, svint8_t, uint64_t);
23081__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_s32)))
23082svint32_t svsli(svint32_t, svint32_t, uint64_t);
23083__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_s64)))
23084svint64_t svsli(svint64_t, svint64_t, uint64_t);
23085__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsli_n_s16)))
23086svint16_t svsli(svint16_t, svint16_t, uint64_t);
23087__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u8_m)))
23088svuint8_t svsqadd_m(svbool_t, svuint8_t, int8_t);
23089__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u32_m)))
23090svuint32_t svsqadd_m(svbool_t, svuint32_t, int32_t);
23091__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u64_m)))
23092svuint64_t svsqadd_m(svbool_t, svuint64_t, int64_t);
23093__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u16_m)))
23094svuint16_t svsqadd_m(svbool_t, svuint16_t, int16_t);
23095__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u8_x)))
23096svuint8_t svsqadd_x(svbool_t, svuint8_t, int8_t);
23097__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u32_x)))
23098svuint32_t svsqadd_x(svbool_t, svuint32_t, int32_t);
23099__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u64_x)))
23100svuint64_t svsqadd_x(svbool_t, svuint64_t, int64_t);
23101__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u16_x)))
23102svuint16_t svsqadd_x(svbool_t, svuint16_t, int16_t);
23103__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u8_z)))
23104svuint8_t svsqadd_z(svbool_t, svuint8_t, int8_t);
23105__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u32_z)))
23106svuint32_t svsqadd_z(svbool_t, svuint32_t, int32_t);
23107__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u64_z)))
23108svuint64_t svsqadd_z(svbool_t, svuint64_t, int64_t);
23109__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_n_u16_z)))
23110svuint16_t svsqadd_z(svbool_t, svuint16_t, int16_t);
23111__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u8_m)))
23112svuint8_t svsqadd_m(svbool_t, svuint8_t, svint8_t);
23113__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u32_m)))
23114svuint32_t svsqadd_m(svbool_t, svuint32_t, svint32_t);
23115__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u64_m)))
23116svuint64_t svsqadd_m(svbool_t, svuint64_t, svint64_t);
23117__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u16_m)))
23118svuint16_t svsqadd_m(svbool_t, svuint16_t, svint16_t);
23119__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u8_x)))
23120svuint8_t svsqadd_x(svbool_t, svuint8_t, svint8_t);
23121__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u32_x)))
23122svuint32_t svsqadd_x(svbool_t, svuint32_t, svint32_t);
23123__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u64_x)))
23124svuint64_t svsqadd_x(svbool_t, svuint64_t, svint64_t);
23125__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u16_x)))
23126svuint16_t svsqadd_x(svbool_t, svuint16_t, svint16_t);
23127__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u8_z)))
23128svuint8_t svsqadd_z(svbool_t, svuint8_t, svint8_t);
23129__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u32_z)))
23130svuint32_t svsqadd_z(svbool_t, svuint32_t, svint32_t);
23131__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u64_z)))
23132svuint64_t svsqadd_z(svbool_t, svuint64_t, svint64_t);
23133__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsqadd_u16_z)))
23134svuint16_t svsqadd_z(svbool_t, svuint16_t, svint16_t);
23135__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_s8)))
23136svint8_t svsra(svint8_t, svint8_t, uint64_t);
23137__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_s32)))
23138svint32_t svsra(svint32_t, svint32_t, uint64_t);
23139__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_s64)))
23140svint64_t svsra(svint64_t, svint64_t, uint64_t);
23141__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_s16)))
23142svint16_t svsra(svint16_t, svint16_t, uint64_t);
23143__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_u8)))
23144svuint8_t svsra(svuint8_t, svuint8_t, uint64_t);
23145__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_u32)))
23146svuint32_t svsra(svuint32_t, svuint32_t, uint64_t);
23147__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_u64)))
23148svuint64_t svsra(svuint64_t, svuint64_t, uint64_t);
23149__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsra_n_u16)))
23150svuint16_t svsra(svuint16_t, svuint16_t, uint64_t);
23151__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_u8)))
23152svuint8_t svsri(svuint8_t, svuint8_t, uint64_t);
23153__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_u32)))
23154svuint32_t svsri(svuint32_t, svuint32_t, uint64_t);
23155__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_u64)))
23156svuint64_t svsri(svuint64_t, svuint64_t, uint64_t);
23157__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_u16)))
23158svuint16_t svsri(svuint16_t, svuint16_t, uint64_t);
23159__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_s8)))
23160svint8_t svsri(svint8_t, svint8_t, uint64_t);
23161__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_s32)))
23162svint32_t svsri(svint32_t, svint32_t, uint64_t);
23163__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_s64)))
23164svint64_t svsri(svint64_t, svint64_t, uint64_t);
23165__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsri_n_s16)))
23166svint16_t svsri(svint16_t, svint16_t, uint64_t);
23167__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_index_u32)))
23168void svstnt1_scatter_index(svbool_t, svuint32_t, int64_t, svuint32_t);
23169__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_index_u64)))
23170void svstnt1_scatter_index(svbool_t, svuint64_t, int64_t, svuint64_t);
23171__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_index_f64)))
23172void svstnt1_scatter_index(svbool_t, svuint64_t, int64_t, svfloat64_t);
23173__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_index_f32)))
23174void svstnt1_scatter_index(svbool_t, svuint32_t, int64_t, svfloat32_t);
23175__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_index_s32)))
23176void svstnt1_scatter_index(svbool_t, svuint32_t, int64_t, svint32_t);
23177__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_index_s64)))
23178void svstnt1_scatter_index(svbool_t, svuint64_t, int64_t, svint64_t);
23179__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_offset_u32)))
23180void svstnt1_scatter_offset(svbool_t, svuint32_t, int64_t, svuint32_t);
23181__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_offset_u64)))
23182void svstnt1_scatter_offset(svbool_t, svuint64_t, int64_t, svuint64_t);
23183__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_offset_f64)))
23184void svstnt1_scatter_offset(svbool_t, svuint64_t, int64_t, svfloat64_t);
23185__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_offset_f32)))
23186void svstnt1_scatter_offset(svbool_t, svuint32_t, int64_t, svfloat32_t);
23187__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_offset_s32)))
23188void svstnt1_scatter_offset(svbool_t, svuint32_t, int64_t, svint32_t);
23189__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_offset_s64)))
23190void svstnt1_scatter_offset(svbool_t, svuint64_t, int64_t, svint64_t);
23191__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_u32)))
23192void svstnt1_scatter(svbool_t, svuint32_t, svuint32_t);
23193__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_u64)))
23194void svstnt1_scatter(svbool_t, svuint64_t, svuint64_t);
23195__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_f64)))
23196void svstnt1_scatter(svbool_t, svuint64_t, svfloat64_t);
23197__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_f32)))
23198void svstnt1_scatter(svbool_t, svuint32_t, svfloat32_t);
23199__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32base_s32)))
23200void svstnt1_scatter(svbool_t, svuint32_t, svint32_t);
23201__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64base_s64)))
23202void svstnt1_scatter(svbool_t, svuint64_t, svint64_t);
23203__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_s64index_u64)))
23204void svstnt1_scatter_index(svbool_t, uint64_t *, svint64_t, svuint64_t);
23205__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_s64index_f64)))
23206void svstnt1_scatter_index(svbool_t, float64_t *, svint64_t, svfloat64_t);
23207__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_s64index_s64)))
23208void svstnt1_scatter_index(svbool_t, int64_t *, svint64_t, svint64_t);
23209__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64index_u64)))
23210void svstnt1_scatter_index(svbool_t, uint64_t *, svuint64_t, svuint64_t);
23211__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64index_f64)))
23212void svstnt1_scatter_index(svbool_t, float64_t *, svuint64_t, svfloat64_t);
23213__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64index_s64)))
23214void svstnt1_scatter_index(svbool_t, int64_t *, svuint64_t, svint64_t);
23215__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32offset_u32)))
23216void svstnt1_scatter_offset(svbool_t, uint32_t *, svuint32_t, svuint32_t);
23217__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32offset_f32)))
23218void svstnt1_scatter_offset(svbool_t, float32_t *, svuint32_t, svfloat32_t);
23219__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u32offset_s32)))
23220void svstnt1_scatter_offset(svbool_t, int32_t *, svuint32_t, svint32_t);
23221__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_s64offset_u64)))
23222void svstnt1_scatter_offset(svbool_t, uint64_t *, svint64_t, svuint64_t);
23223__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_s64offset_f64)))
23224void svstnt1_scatter_offset(svbool_t, float64_t *, svint64_t, svfloat64_t);
23225__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_s64offset_s64)))
23226void svstnt1_scatter_offset(svbool_t, int64_t *, svint64_t, svint64_t);
23227__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64offset_u64)))
23228void svstnt1_scatter_offset(svbool_t, uint64_t *, svuint64_t, svuint64_t);
23229__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64offset_f64)))
23230void svstnt1_scatter_offset(svbool_t, float64_t *, svuint64_t, svfloat64_t);
23231__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1_scatter_u64offset_s64)))
23232void svstnt1_scatter_offset(svbool_t, int64_t *, svuint64_t, svint64_t);
23233__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u32base_offset_u32)))
23234void svstnt1b_scatter_offset(svbool_t, svuint32_t, int64_t, svuint32_t);
23235__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u64base_offset_u64)))
23236void svstnt1b_scatter_offset(svbool_t, svuint64_t, int64_t, svuint64_t);
23237__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u32base_offset_s32)))
23238void svstnt1b_scatter_offset(svbool_t, svuint32_t, int64_t, svint32_t);
23239__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u64base_offset_s64)))
23240void svstnt1b_scatter_offset(svbool_t, svuint64_t, int64_t, svint64_t);
23241__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u32base_u32)))
23242void svstnt1b_scatter(svbool_t, svuint32_t, svuint32_t);
23243__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u64base_u64)))
23244void svstnt1b_scatter(svbool_t, svuint64_t, svuint64_t);
23245__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u32base_s32)))
23246void svstnt1b_scatter(svbool_t, svuint32_t, svint32_t);
23247__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u64base_s64)))
23248void svstnt1b_scatter(svbool_t, svuint64_t, svint64_t);
23249__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u32offset_s32)))
23250void svstnt1b_scatter_offset(svbool_t, int8_t *, svuint32_t, svint32_t);
23251__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u32offset_u32)))
23252void svstnt1b_scatter_offset(svbool_t, uint8_t *, svuint32_t, svuint32_t);
23253__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_s64offset_s64)))
23254void svstnt1b_scatter_offset(svbool_t, int8_t *, svint64_t, svint64_t);
23255__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_s64offset_u64)))
23256void svstnt1b_scatter_offset(svbool_t, uint8_t *, svint64_t, svuint64_t);
23257__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u64offset_s64)))
23258void svstnt1b_scatter_offset(svbool_t, int8_t *, svuint64_t, svint64_t);
23259__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1b_scatter_u64offset_u64)))
23260void svstnt1b_scatter_offset(svbool_t, uint8_t *, svuint64_t, svuint64_t);
23261__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32base_index_u32)))
23262void svstnt1h_scatter_index(svbool_t, svuint32_t, int64_t, svuint32_t);
23263__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64base_index_u64)))
23264void svstnt1h_scatter_index(svbool_t, svuint64_t, int64_t, svuint64_t);
23265__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32base_index_s32)))
23266void svstnt1h_scatter_index(svbool_t, svuint32_t, int64_t, svint32_t);
23267__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64base_index_s64)))
23268void svstnt1h_scatter_index(svbool_t, svuint64_t, int64_t, svint64_t);
23269__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32base_offset_u32)))
23270void svstnt1h_scatter_offset(svbool_t, svuint32_t, int64_t, svuint32_t);
23271__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64base_offset_u64)))
23272void svstnt1h_scatter_offset(svbool_t, svuint64_t, int64_t, svuint64_t);
23273__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32base_offset_s32)))
23274void svstnt1h_scatter_offset(svbool_t, svuint32_t, int64_t, svint32_t);
23275__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64base_offset_s64)))
23276void svstnt1h_scatter_offset(svbool_t, svuint64_t, int64_t, svint64_t);
23277__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32base_u32)))
23278void svstnt1h_scatter(svbool_t, svuint32_t, svuint32_t);
23279__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64base_u64)))
23280void svstnt1h_scatter(svbool_t, svuint64_t, svuint64_t);
23281__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32base_s32)))
23282void svstnt1h_scatter(svbool_t, svuint32_t, svint32_t);
23283__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64base_s64)))
23284void svstnt1h_scatter(svbool_t, svuint64_t, svint64_t);
23285__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_s64index_s64)))
23286void svstnt1h_scatter_index(svbool_t, int16_t *, svint64_t, svint64_t);
23287__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_s64index_u64)))
23288void svstnt1h_scatter_index(svbool_t, uint16_t *, svint64_t, svuint64_t);
23289__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64index_s64)))
23290void svstnt1h_scatter_index(svbool_t, int16_t *, svuint64_t, svint64_t);
23291__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64index_u64)))
23292void svstnt1h_scatter_index(svbool_t, uint16_t *, svuint64_t, svuint64_t);
23293__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32offset_s32)))
23294void svstnt1h_scatter_offset(svbool_t, int16_t *, svuint32_t, svint32_t);
23295__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u32offset_u32)))
23296void svstnt1h_scatter_offset(svbool_t, uint16_t *, svuint32_t, svuint32_t);
23297__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_s64offset_s64)))
23298void svstnt1h_scatter_offset(svbool_t, int16_t *, svint64_t, svint64_t);
23299__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_s64offset_u64)))
23300void svstnt1h_scatter_offset(svbool_t, uint16_t *, svint64_t, svuint64_t);
23301__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64offset_s64)))
23302void svstnt1h_scatter_offset(svbool_t, int16_t *, svuint64_t, svint64_t);
23303__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1h_scatter_u64offset_u64)))
23304void svstnt1h_scatter_offset(svbool_t, uint16_t *, svuint64_t, svuint64_t);
23305__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64base_index_u64)))
23306void svstnt1w_scatter_index(svbool_t, svuint64_t, int64_t, svuint64_t);
23307__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64base_index_s64)))
23308void svstnt1w_scatter_index(svbool_t, svuint64_t, int64_t, svint64_t);
23309__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64base_offset_u64)))
23310void svstnt1w_scatter_offset(svbool_t, svuint64_t, int64_t, svuint64_t);
23311__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64base_offset_s64)))
23312void svstnt1w_scatter_offset(svbool_t, svuint64_t, int64_t, svint64_t);
23313__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64base_u64)))
23314void svstnt1w_scatter(svbool_t, svuint64_t, svuint64_t);
23315__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64base_s64)))
23316void svstnt1w_scatter(svbool_t, svuint64_t, svint64_t);
23317__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_s64index_s64)))
23318void svstnt1w_scatter_index(svbool_t, int32_t *, svint64_t, svint64_t);
23319__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_s64index_u64)))
23320void svstnt1w_scatter_index(svbool_t, uint32_t *, svint64_t, svuint64_t);
23321__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64index_s64)))
23322void svstnt1w_scatter_index(svbool_t, int32_t *, svuint64_t, svint64_t);
23323__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64index_u64)))
23324void svstnt1w_scatter_index(svbool_t, uint32_t *, svuint64_t, svuint64_t);
23325__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_s64offset_s64)))
23326void svstnt1w_scatter_offset(svbool_t, int32_t *, svint64_t, svint64_t);
23327__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_s64offset_u64)))
23328void svstnt1w_scatter_offset(svbool_t, uint32_t *, svint64_t, svuint64_t);
23329__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64offset_s64)))
23330void svstnt1w_scatter_offset(svbool_t, int32_t *, svuint64_t, svint64_t);
23331__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svstnt1w_scatter_u64offset_u64)))
23332void svstnt1w_scatter_offset(svbool_t, uint32_t *, svuint64_t, svuint64_t);
23333__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_n_u32)))
23334svuint16_t svsubhnb(svuint32_t, uint32_t);
23335__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_n_u64)))
23336svuint32_t svsubhnb(svuint64_t, uint64_t);
23337__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_n_u16)))
23338svuint8_t svsubhnb(svuint16_t, uint16_t);
23339__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_n_s32)))
23340svint16_t svsubhnb(svint32_t, int32_t);
23341__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_n_s64)))
23342svint32_t svsubhnb(svint64_t, int64_t);
23343__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_n_s16)))
23344svint8_t svsubhnb(svint16_t, int16_t);
23345__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_u32)))
23346svuint16_t svsubhnb(svuint32_t, svuint32_t);
23347__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_u64)))
23348svuint32_t svsubhnb(svuint64_t, svuint64_t);
23349__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_u16)))
23350svuint8_t svsubhnb(svuint16_t, svuint16_t);
23351__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_s32)))
23352svint16_t svsubhnb(svint32_t, svint32_t);
23353__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_s64)))
23354svint32_t svsubhnb(svint64_t, svint64_t);
23355__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnb_s16)))
23356svint8_t svsubhnb(svint16_t, svint16_t);
23357__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_n_u32)))
23358svuint16_t svsubhnt(svuint16_t, svuint32_t, uint32_t);
23359__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_n_u64)))
23360svuint32_t svsubhnt(svuint32_t, svuint64_t, uint64_t);
23361__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_n_u16)))
23362svuint8_t svsubhnt(svuint8_t, svuint16_t, uint16_t);
23363__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_n_s32)))
23364svint16_t svsubhnt(svint16_t, svint32_t, int32_t);
23365__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_n_s64)))
23366svint32_t svsubhnt(svint32_t, svint64_t, int64_t);
23367__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_n_s16)))
23368svint8_t svsubhnt(svint8_t, svint16_t, int16_t);
23369__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_u32)))
23370svuint16_t svsubhnt(svuint16_t, svuint32_t, svuint32_t);
23371__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_u64)))
23372svuint32_t svsubhnt(svuint32_t, svuint64_t, svuint64_t);
23373__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_u16)))
23374svuint8_t svsubhnt(svuint8_t, svuint16_t, svuint16_t);
23375__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_s32)))
23376svint16_t svsubhnt(svint16_t, svint32_t, svint32_t);
23377__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_s64)))
23378svint32_t svsubhnt(svint32_t, svint64_t, svint64_t);
23379__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubhnt_s16)))
23380svint8_t svsubhnt(svint8_t, svint16_t, svint16_t);
23381__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_n_s32)))
23382svint32_t svsublb(svint16_t, int16_t);
23383__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_n_s64)))
23384svint64_t svsublb(svint32_t, int32_t);
23385__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_n_s16)))
23386svint16_t svsublb(svint8_t, int8_t);
23387__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_n_u32)))
23388svuint32_t svsublb(svuint16_t, uint16_t);
23389__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_n_u64)))
23390svuint64_t svsublb(svuint32_t, uint32_t);
23391__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_n_u16)))
23392svuint16_t svsublb(svuint8_t, uint8_t);
23393__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_s32)))
23394svint32_t svsublb(svint16_t, svint16_t);
23395__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_s64)))
23396svint64_t svsublb(svint32_t, svint32_t);
23397__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_s16)))
23398svint16_t svsublb(svint8_t, svint8_t);
23399__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_u32)))
23400svuint32_t svsublb(svuint16_t, svuint16_t);
23401__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_u64)))
23402svuint64_t svsublb(svuint32_t, svuint32_t);
23403__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublb_u16)))
23404svuint16_t svsublb(svuint8_t, svuint8_t);
23405__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublbt_n_s32)))
23406svint32_t svsublbt(svint16_t, int16_t);
23407__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublbt_n_s64)))
23408svint64_t svsublbt(svint32_t, int32_t);
23409__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublbt_n_s16)))
23410svint16_t svsublbt(svint8_t, int8_t);
23411__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublbt_s32)))
23412svint32_t svsublbt(svint16_t, svint16_t);
23413__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublbt_s64)))
23414svint64_t svsublbt(svint32_t, svint32_t);
23415__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublbt_s16)))
23416svint16_t svsublbt(svint8_t, svint8_t);
23417__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_n_s32)))
23418svint32_t svsublt(svint16_t, int16_t);
23419__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_n_s64)))
23420svint64_t svsublt(svint32_t, int32_t);
23421__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_n_s16)))
23422svint16_t svsublt(svint8_t, int8_t);
23423__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_n_u32)))
23424svuint32_t svsublt(svuint16_t, uint16_t);
23425__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_n_u64)))
23426svuint64_t svsublt(svuint32_t, uint32_t);
23427__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_n_u16)))
23428svuint16_t svsublt(svuint8_t, uint8_t);
23429__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_s32)))
23430svint32_t svsublt(svint16_t, svint16_t);
23431__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_s64)))
23432svint64_t svsublt(svint32_t, svint32_t);
23433__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_s16)))
23434svint16_t svsublt(svint8_t, svint8_t);
23435__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_u32)))
23436svuint32_t svsublt(svuint16_t, svuint16_t);
23437__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_u64)))
23438svuint64_t svsublt(svuint32_t, svuint32_t);
23439__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsublt_u16)))
23440svuint16_t svsublt(svuint8_t, svuint8_t);
23441__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubltb_n_s32)))
23442svint32_t svsubltb(svint16_t, int16_t);
23443__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubltb_n_s64)))
23444svint64_t svsubltb(svint32_t, int32_t);
23445__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubltb_n_s16)))
23446svint16_t svsubltb(svint8_t, int8_t);
23447__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubltb_s32)))
23448svint32_t svsubltb(svint16_t, svint16_t);
23449__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubltb_s64)))
23450svint64_t svsubltb(svint32_t, svint32_t);
23451__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubltb_s16)))
23452svint16_t svsubltb(svint8_t, svint8_t);
23453__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_n_s32)))
23454svint32_t svsubwb(svint32_t, int16_t);
23455__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_n_s64)))
23456svint64_t svsubwb(svint64_t, int32_t);
23457__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_n_s16)))
23458svint16_t svsubwb(svint16_t, int8_t);
23459__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_n_u32)))
23460svuint32_t svsubwb(svuint32_t, uint16_t);
23461__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_n_u64)))
23462svuint64_t svsubwb(svuint64_t, uint32_t);
23463__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_n_u16)))
23464svuint16_t svsubwb(svuint16_t, uint8_t);
23465__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_s32)))
23466svint32_t svsubwb(svint32_t, svint16_t);
23467__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_s64)))
23468svint64_t svsubwb(svint64_t, svint32_t);
23469__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_s16)))
23470svint16_t svsubwb(svint16_t, svint8_t);
23471__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_u32)))
23472svuint32_t svsubwb(svuint32_t, svuint16_t);
23473__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_u64)))
23474svuint64_t svsubwb(svuint64_t, svuint32_t);
23475__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwb_u16)))
23476svuint16_t svsubwb(svuint16_t, svuint8_t);
23477__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_n_s32)))
23478svint32_t svsubwt(svint32_t, int16_t);
23479__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_n_s64)))
23480svint64_t svsubwt(svint64_t, int32_t);
23481__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_n_s16)))
23482svint16_t svsubwt(svint16_t, int8_t);
23483__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_n_u32)))
23484svuint32_t svsubwt(svuint32_t, uint16_t);
23485__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_n_u64)))
23486svuint64_t svsubwt(svuint64_t, uint32_t);
23487__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_n_u16)))
23488svuint16_t svsubwt(svuint16_t, uint8_t);
23489__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_s32)))
23490svint32_t svsubwt(svint32_t, svint16_t);
23491__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_s64)))
23492svint64_t svsubwt(svint64_t, svint32_t);
23493__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_s16)))
23494svint16_t svsubwt(svint16_t, svint8_t);
23495__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_u32)))
23496svuint32_t svsubwt(svuint32_t, svuint16_t);
23497__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_u64)))
23498svuint64_t svsubwt(svuint64_t, svuint32_t);
23499__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsubwt_u16)))
23500svuint16_t svsubwt(svuint16_t, svuint8_t);
23501__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_u8)))
23502svuint8_t svtbl2(svuint8x2_t, svuint8_t);
23503__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_u32)))
23504svuint32_t svtbl2(svuint32x2_t, svuint32_t);
23505__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_u64)))
23506svuint64_t svtbl2(svuint64x2_t, svuint64_t);
23507__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_u16)))
23508svuint16_t svtbl2(svuint16x2_t, svuint16_t);
23509__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_s8)))
23510svint8_t svtbl2(svint8x2_t, svuint8_t);
23511__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_f64)))
23512svfloat64_t svtbl2(svfloat64x2_t, svuint64_t);
23513__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_f32)))
23514svfloat32_t svtbl2(svfloat32x2_t, svuint32_t);
23515__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_f16)))
23516svfloat16_t svtbl2(svfloat16x2_t, svuint16_t);
23517__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_s32)))
23518svint32_t svtbl2(svint32x2_t, svuint32_t);
23519__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_s64)))
23520svint64_t svtbl2(svint64x2_t, svuint64_t);
23521__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_s16)))
23522svint16_t svtbl2(svint16x2_t, svuint16_t);
23523__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_u8)))
23524svuint8_t svtbx(svuint8_t, svuint8_t, svuint8_t);
23525__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_u32)))
23526svuint32_t svtbx(svuint32_t, svuint32_t, svuint32_t);
23527__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_u64)))
23528svuint64_t svtbx(svuint64_t, svuint64_t, svuint64_t);
23529__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_u16)))
23530svuint16_t svtbx(svuint16_t, svuint16_t, svuint16_t);
23531__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_s8)))
23532svint8_t svtbx(svint8_t, svint8_t, svuint8_t);
23533__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_f64)))
23534svfloat64_t svtbx(svfloat64_t, svfloat64_t, svuint64_t);
23535__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_f32)))
23536svfloat32_t svtbx(svfloat32_t, svfloat32_t, svuint32_t);
23537__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_f16)))
23538svfloat16_t svtbx(svfloat16_t, svfloat16_t, svuint16_t);
23539__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_s32)))
23540svint32_t svtbx(svint32_t, svint32_t, svuint32_t);
23541__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_s64)))
23542svint64_t svtbx(svint64_t, svint64_t, svuint64_t);
23543__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_s16)))
23544svint16_t svtbx(svint16_t, svint16_t, svuint16_t);
23545__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s8_m)))
23546svint8_t svuqadd_m(svbool_t, svint8_t, uint8_t);
23547__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s32_m)))
23548svint32_t svuqadd_m(svbool_t, svint32_t, uint32_t);
23549__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s64_m)))
23550svint64_t svuqadd_m(svbool_t, svint64_t, uint64_t);
23551__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s16_m)))
23552svint16_t svuqadd_m(svbool_t, svint16_t, uint16_t);
23553__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s8_x)))
23554svint8_t svuqadd_x(svbool_t, svint8_t, uint8_t);
23555__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s32_x)))
23556svint32_t svuqadd_x(svbool_t, svint32_t, uint32_t);
23557__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s64_x)))
23558svint64_t svuqadd_x(svbool_t, svint64_t, uint64_t);
23559__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s16_x)))
23560svint16_t svuqadd_x(svbool_t, svint16_t, uint16_t);
23561__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s8_z)))
23562svint8_t svuqadd_z(svbool_t, svint8_t, uint8_t);
23563__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s32_z)))
23564svint32_t svuqadd_z(svbool_t, svint32_t, uint32_t);
23565__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s64_z)))
23566svint64_t svuqadd_z(svbool_t, svint64_t, uint64_t);
23567__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_n_s16_z)))
23568svint16_t svuqadd_z(svbool_t, svint16_t, uint16_t);
23569__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s8_m)))
23570svint8_t svuqadd_m(svbool_t, svint8_t, svuint8_t);
23571__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s32_m)))
23572svint32_t svuqadd_m(svbool_t, svint32_t, svuint32_t);
23573__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s64_m)))
23574svint64_t svuqadd_m(svbool_t, svint64_t, svuint64_t);
23575__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s16_m)))
23576svint16_t svuqadd_m(svbool_t, svint16_t, svuint16_t);
23577__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s8_x)))
23578svint8_t svuqadd_x(svbool_t, svint8_t, svuint8_t);
23579__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s32_x)))
23580svint32_t svuqadd_x(svbool_t, svint32_t, svuint32_t);
23581__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s64_x)))
23582svint64_t svuqadd_x(svbool_t, svint64_t, svuint64_t);
23583__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s16_x)))
23584svint16_t svuqadd_x(svbool_t, svint16_t, svuint16_t);
23585__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s8_z)))
23586svint8_t svuqadd_z(svbool_t, svint8_t, svuint8_t);
23587__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s32_z)))
23588svint32_t svuqadd_z(svbool_t, svint32_t, svuint32_t);
23589__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s64_z)))
23590svint64_t svuqadd_z(svbool_t, svint64_t, svuint64_t);
23591__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svuqadd_s16_z)))
23592svint16_t svuqadd_z(svbool_t, svint16_t, svuint16_t);
23593__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b8_s32)))
23594svbool_t svwhilege_b8(int32_t, int32_t);
23595__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b32_s32)))
23596svbool_t svwhilege_b32(int32_t, int32_t);
23597__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b64_s32)))
23598svbool_t svwhilege_b64(int32_t, int32_t);
23599__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b16_s32)))
23600svbool_t svwhilege_b16(int32_t, int32_t);
23601__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b8_s64)))
23602svbool_t svwhilege_b8(int64_t, int64_t);
23603__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b32_s64)))
23604svbool_t svwhilege_b32(int64_t, int64_t);
23605__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b64_s64)))
23606svbool_t svwhilege_b64(int64_t, int64_t);
23607__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b16_s64)))
23608svbool_t svwhilege_b16(int64_t, int64_t);
23609__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b8_u32)))
23610svbool_t svwhilege_b8(uint32_t, uint32_t);
23611__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b32_u32)))
23612svbool_t svwhilege_b32(uint32_t, uint32_t);
23613__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b64_u32)))
23614svbool_t svwhilege_b64(uint32_t, uint32_t);
23615__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b16_u32)))
23616svbool_t svwhilege_b16(uint32_t, uint32_t);
23617__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b8_u64)))
23618svbool_t svwhilege_b8(uint64_t, uint64_t);
23619__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b32_u64)))
23620svbool_t svwhilege_b32(uint64_t, uint64_t);
23621__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b64_u64)))
23622svbool_t svwhilege_b64(uint64_t, uint64_t);
23623__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilege_b16_u64)))
23624svbool_t svwhilege_b16(uint64_t, uint64_t);
23625__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b8_s32)))
23626svbool_t svwhilegt_b8(int32_t, int32_t);
23627__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b32_s32)))
23628svbool_t svwhilegt_b32(int32_t, int32_t);
23629__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b64_s32)))
23630svbool_t svwhilegt_b64(int32_t, int32_t);
23631__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b16_s32)))
23632svbool_t svwhilegt_b16(int32_t, int32_t);
23633__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b8_s64)))
23634svbool_t svwhilegt_b8(int64_t, int64_t);
23635__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b32_s64)))
23636svbool_t svwhilegt_b32(int64_t, int64_t);
23637__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b64_s64)))
23638svbool_t svwhilegt_b64(int64_t, int64_t);
23639__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b16_s64)))
23640svbool_t svwhilegt_b16(int64_t, int64_t);
23641__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b8_u32)))
23642svbool_t svwhilegt_b8(uint32_t, uint32_t);
23643__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b32_u32)))
23644svbool_t svwhilegt_b32(uint32_t, uint32_t);
23645__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b64_u32)))
23646svbool_t svwhilegt_b64(uint32_t, uint32_t);
23647__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b16_u32)))
23648svbool_t svwhilegt_b16(uint32_t, uint32_t);
23649__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b8_u64)))
23650svbool_t svwhilegt_b8(uint64_t, uint64_t);
23651__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b32_u64)))
23652svbool_t svwhilegt_b32(uint64_t, uint64_t);
23653__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b64_u64)))
23654svbool_t svwhilegt_b64(uint64_t, uint64_t);
23655__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilegt_b16_u64)))
23656svbool_t svwhilegt_b16(uint64_t, uint64_t);
23657__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_u8)))
23658svbool_t svwhilerw(uint8_t const *, uint8_t const *);
23659__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_s8)))
23660svbool_t svwhilerw(int8_t const *, int8_t const *);
23661__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_u64)))
23662svbool_t svwhilerw(uint64_t const *, uint64_t const *);
23663__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_f64)))
23664svbool_t svwhilerw(float64_t const *, float64_t const *);
23665__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_s64)))
23666svbool_t svwhilerw(int64_t const *, int64_t const *);
23667__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_u16)))
23668svbool_t svwhilerw(uint16_t const *, uint16_t const *);
23669__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_f16)))
23670svbool_t svwhilerw(float16_t const *, float16_t const *);
23671__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_s16)))
23672svbool_t svwhilerw(int16_t const *, int16_t const *);
23673__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_u32)))
23674svbool_t svwhilerw(uint32_t const *, uint32_t const *);
23675__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_f32)))
23676svbool_t svwhilerw(float32_t const *, float32_t const *);
23677__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_s32)))
23678svbool_t svwhilerw(int32_t const *, int32_t const *);
23679__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_u8)))
23680svbool_t svwhilewr(uint8_t const *, uint8_t const *);
23681__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_s8)))
23682svbool_t svwhilewr(int8_t const *, int8_t const *);
23683__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_u64)))
23684svbool_t svwhilewr(uint64_t const *, uint64_t const *);
23685__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_f64)))
23686svbool_t svwhilewr(float64_t const *, float64_t const *);
23687__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_s64)))
23688svbool_t svwhilewr(int64_t const *, int64_t const *);
23689__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_u16)))
23690svbool_t svwhilewr(uint16_t const *, uint16_t const *);
23691__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_f16)))
23692svbool_t svwhilewr(float16_t const *, float16_t const *);
23693__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_s16)))
23694svbool_t svwhilewr(int16_t const *, int16_t const *);
23695__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_u32)))
23696svbool_t svwhilewr(uint32_t const *, uint32_t const *);
23697__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_f32)))
23698svbool_t svwhilewr(float32_t const *, float32_t const *);
23699__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_s32)))
23700svbool_t svwhilewr(int32_t const *, int32_t const *);
23701__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_u8)))
23702svuint8_t svxar(svuint8_t, svuint8_t, uint64_t);
23703__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_u32)))
23704svuint32_t svxar(svuint32_t, svuint32_t, uint64_t);
23705__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_u64)))
23706svuint64_t svxar(svuint64_t, svuint64_t, uint64_t);
23707__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_u16)))
23708svuint16_t svxar(svuint16_t, svuint16_t, uint64_t);
23709__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_s8)))
23710svint8_t svxar(svint8_t, svint8_t, uint64_t);
23711__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_s32)))
23712svint32_t svxar(svint32_t, svint32_t, uint64_t);
23713__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_s64)))
23714svint64_t svxar(svint64_t, svint64_t, uint64_t);
23715__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svxar_n_s16)))
23716svint16_t svxar(svint16_t, svint16_t, uint64_t);
23717__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_bf16)))
23718svbfloat16_t svtbl2_bf16(svbfloat16x2_t, svuint16_t);
23719__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_bf16)))
23720svbfloat16_t svtbx_bf16(svbfloat16_t, svbfloat16_t, svuint16_t);
23721__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_bf16)))
23722svbool_t svwhilerw_bf16(bfloat16_t const *, bfloat16_t const *);
23723__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_bf16)))
23724svbool_t svwhilewr_bf16(bfloat16_t const *, bfloat16_t const *);
23725__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbl2_bf16)))
23726svbfloat16_t svtbl2(svbfloat16x2_t, svuint16_t);
23727__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svtbx_bf16)))
23728svbfloat16_t svtbx(svbfloat16_t, svbfloat16_t, svuint16_t);
23729__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilerw_bf16)))
23730svbool_t svwhilerw(bfloat16_t const *, bfloat16_t const *);
23731__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svwhilewr_bf16)))
23732svbool_t svwhilewr(bfloat16_t const *, bfloat16_t const *);
23733__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaesd_u8)))
23734svuint8_t svaesd_u8(svuint8_t, svuint8_t);
23735__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaese_u8)))
23736svuint8_t svaese_u8(svuint8_t, svuint8_t);
23737__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaesimc_u8)))
23738svuint8_t svaesimc_u8(svuint8_t);
23739__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaesmc_u8)))
23740svuint8_t svaesmc_u8(svuint8_t);
23741__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_pair_n_u64)))
23742svuint64_t svpmullb_pair_n_u64(svuint64_t, uint64_t);
23743__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_pair_u64)))
23744svuint64_t svpmullb_pair_u64(svuint64_t, svuint64_t);
23745__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_pair_n_u64)))
23746svuint64_t svpmullt_pair_n_u64(svuint64_t, uint64_t);
23747__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_pair_u64)))
23748svuint64_t svpmullt_pair_u64(svuint64_t, svuint64_t);
23749__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaesd_u8)))
23750svuint8_t svaesd(svuint8_t, svuint8_t);
23751__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaese_u8)))
23752svuint8_t svaese(svuint8_t, svuint8_t);
23753__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaesimc_u8)))
23754svuint8_t svaesimc(svuint8_t);
23755__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svaesmc_u8)))
23756svuint8_t svaesmc(svuint8_t);
23757__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_pair_n_u64)))
23758svuint64_t svpmullb_pair(svuint64_t, uint64_t);
23759__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullb_pair_u64)))
23760svuint64_t svpmullb_pair(svuint64_t, svuint64_t);
23761__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_pair_n_u64)))
23762svuint64_t svpmullt_pair(svuint64_t, uint64_t);
23763__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svpmullt_pair_u64)))
23764svuint64_t svpmullt_pair(svuint64_t, svuint64_t);
23765__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_n_u8)))
23766svuint8_t svbdep_n_u8(svuint8_t, uint8_t);
23767__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_n_u32)))
23768svuint32_t svbdep_n_u32(svuint32_t, uint32_t);
23769__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_n_u64)))
23770svuint64_t svbdep_n_u64(svuint64_t, uint64_t);
23771__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_n_u16)))
23772svuint16_t svbdep_n_u16(svuint16_t, uint16_t);
23773__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_u8)))
23774svuint8_t svbdep_u8(svuint8_t, svuint8_t);
23775__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_u32)))
23776svuint32_t svbdep_u32(svuint32_t, svuint32_t);
23777__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_u64)))
23778svuint64_t svbdep_u64(svuint64_t, svuint64_t);
23779__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_u16)))
23780svuint16_t svbdep_u16(svuint16_t, svuint16_t);
23781__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_n_u8)))
23782svuint8_t svbext_n_u8(svuint8_t, uint8_t);
23783__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_n_u32)))
23784svuint32_t svbext_n_u32(svuint32_t, uint32_t);
23785__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_n_u64)))
23786svuint64_t svbext_n_u64(svuint64_t, uint64_t);
23787__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_n_u16)))
23788svuint16_t svbext_n_u16(svuint16_t, uint16_t);
23789__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_u8)))
23790svuint8_t svbext_u8(svuint8_t, svuint8_t);
23791__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_u32)))
23792svuint32_t svbext_u32(svuint32_t, svuint32_t);
23793__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_u64)))
23794svuint64_t svbext_u64(svuint64_t, svuint64_t);
23795__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_u16)))
23796svuint16_t svbext_u16(svuint16_t, svuint16_t);
23797__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_n_u8)))
23798svuint8_t svbgrp_n_u8(svuint8_t, uint8_t);
23799__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_n_u32)))
23800svuint32_t svbgrp_n_u32(svuint32_t, uint32_t);
23801__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_n_u64)))
23802svuint64_t svbgrp_n_u64(svuint64_t, uint64_t);
23803__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_n_u16)))
23804svuint16_t svbgrp_n_u16(svuint16_t, uint16_t);
23805__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_u8)))
23806svuint8_t svbgrp_u8(svuint8_t, svuint8_t);
23807__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_u32)))
23808svuint32_t svbgrp_u32(svuint32_t, svuint32_t);
23809__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_u64)))
23810svuint64_t svbgrp_u64(svuint64_t, svuint64_t);
23811__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_u16)))
23812svuint16_t svbgrp_u16(svuint16_t, svuint16_t);
23813__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_n_u8)))
23814svuint8_t svbdep(svuint8_t, uint8_t);
23815__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_n_u32)))
23816svuint32_t svbdep(svuint32_t, uint32_t);
23817__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_n_u64)))
23818svuint64_t svbdep(svuint64_t, uint64_t);
23819__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_n_u16)))
23820svuint16_t svbdep(svuint16_t, uint16_t);
23821__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_u8)))
23822svuint8_t svbdep(svuint8_t, svuint8_t);
23823__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_u32)))
23824svuint32_t svbdep(svuint32_t, svuint32_t);
23825__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_u64)))
23826svuint64_t svbdep(svuint64_t, svuint64_t);
23827__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbdep_u16)))
23828svuint16_t svbdep(svuint16_t, svuint16_t);
23829__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_n_u8)))
23830svuint8_t svbext(svuint8_t, uint8_t);
23831__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_n_u32)))
23832svuint32_t svbext(svuint32_t, uint32_t);
23833__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_n_u64)))
23834svuint64_t svbext(svuint64_t, uint64_t);
23835__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_n_u16)))
23836svuint16_t svbext(svuint16_t, uint16_t);
23837__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_u8)))
23838svuint8_t svbext(svuint8_t, svuint8_t);
23839__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_u32)))
23840svuint32_t svbext(svuint32_t, svuint32_t);
23841__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_u64)))
23842svuint64_t svbext(svuint64_t, svuint64_t);
23843__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbext_u16)))
23844svuint16_t svbext(svuint16_t, svuint16_t);
23845__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_n_u8)))
23846svuint8_t svbgrp(svuint8_t, uint8_t);
23847__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_n_u32)))
23848svuint32_t svbgrp(svuint32_t, uint32_t);
23849__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_n_u64)))
23850svuint64_t svbgrp(svuint64_t, uint64_t);
23851__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_n_u16)))
23852svuint16_t svbgrp(svuint16_t, uint16_t);
23853__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_u8)))
23854svuint8_t svbgrp(svuint8_t, svuint8_t);
23855__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_u32)))
23856svuint32_t svbgrp(svuint32_t, svuint32_t);
23857__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_u64)))
23858svuint64_t svbgrp(svuint64_t, svuint64_t);
23859__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svbgrp_u16)))
23860svuint16_t svbgrp(svuint16_t, svuint16_t);
23861__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrax1_u64)))
23862svuint64_t svrax1_u64(svuint64_t, svuint64_t);
23863__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrax1_s64)))
23864svint64_t svrax1_s64(svint64_t, svint64_t);
23865__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrax1_u64)))
23866svuint64_t svrax1(svuint64_t, svuint64_t);
23867__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svrax1_s64)))
23868svint64_t svrax1(svint64_t, svint64_t);
23869__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsm4e_u32)))
23870svuint32_t svsm4e_u32(svuint32_t, svuint32_t);
23871__ai __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsm4ekey_u32)))
23872svuint32_t svsm4ekey_u32(svuint32_t, svuint32_t);
23873__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsm4e_u32)))
23874svuint32_t svsm4e(svuint32_t, svuint32_t);
23875__aio __attribute__((__clang_arm_builtin_alias(__builtin_sve_svsm4ekey_u32)))
23876svuint32_t svsm4ekey(svuint32_t, svuint32_t);
2402223877#define svcvtnt_bf16_x svcvtnt_bf16_m
2402323878#define svcvtnt_bf16_f32_x svcvtnt_bf16_f32_m
24024#endif /*__ARM_FEATURE_SVE_BF16 */
24025
24026#if defined(__ARM_FEATURE_SVE2)
2402723879#define svcvtnt_f16_x svcvtnt_f16_m
2402823880#define svcvtnt_f16_f32_x svcvtnt_f16_f32_m
2402923881#define svcvtnt_f32_x svcvtnt_f32_m
......@@ -24032,8 +23884,6 @@ svint32_t svusmmla(svint32_t, svuint8_t, svint8_t);
2403223884#define svcvtxnt_f32_x svcvtxnt_f32_m
2403323885#define svcvtxnt_f32_f64_x svcvtxnt_f32_f64_m
2403423886
24035#endif /*__ARM_FEATURE_SVE2 */
24036
2403723887#ifdef __cplusplus
2403823888} // extern "C"
2403923889#endif
......@@ -24042,6 +23892,4 @@ svint32_t svusmmla(svint32_t, svuint8_t, svint8_t);
2404223892
2404323893#undef __aio
2404423894
24045#endif /*__ARM_FEATURE_SVE */
24046
2404723895#endif /* __ARM_SVE_H */
lib/include/avx512bf16intrin.h+18-15
......@@ -10,12 +10,14 @@
1010#error "Never use <avx512bf16intrin.h> directly; include <immintrin.h> instead."
1111#endif
1212
13#ifdef __SSE2__
14
1315#ifndef __AVX512BF16INTRIN_H
1416#define __AVX512BF16INTRIN_H
1517
16typedef short __m512bh __attribute__((__vector_size__(64), __aligned__(64)));
17typedef short __m256bh __attribute__((__vector_size__(32), __aligned__(32)));
18typedef unsigned short __bfloat16;
18typedef __bf16 __v32bf __attribute__((__vector_size__(64), __aligned__(64)));
19typedef __bf16 __m512bh __attribute__((__vector_size__(64), __aligned__(64)));
20typedef __bf16 __bfloat16 __attribute__((deprecated("use __bf16 instead")));
1921
2022#define __DEFAULT_FN_ATTRS512 \
2123 __attribute__((__always_inline__, __nodebug__, __target__("avx512bf16"), \
......@@ -33,7 +35,7 @@ typedef unsigned short __bfloat16;
3335/// A bfloat data.
3436/// \returns A float data whose sign field and exponent field keep unchanged,
3537/// and fraction field is extended to 23 bits.
36static __inline__ float __DEFAULT_FN_ATTRS _mm_cvtsbh_ss(__bfloat16 __A) {
38static __inline__ float __DEFAULT_FN_ATTRS _mm_cvtsbh_ss(__bf16 __A) {
3739 return __builtin_ia32_cvtsbf162ss_32(__A);
3840}
3941
......@@ -74,9 +76,9 @@ _mm512_cvtne2ps_pbh(__m512 __A, __m512 __B) {
7476/// conversion of __B, and higher 256 bits come from conversion of __A.
7577static __inline__ __m512bh __DEFAULT_FN_ATTRS512
7678_mm512_mask_cvtne2ps_pbh(__m512bh __W, __mmask32 __U, __m512 __A, __m512 __B) {
77 return (__m512bh)__builtin_ia32_selectw_512((__mmask32)__U,
78 (__v32hi)_mm512_cvtne2ps_pbh(__A, __B),
79 (__v32hi)__W);
79 return (__m512bh)__builtin_ia32_selectpbf_512((__mmask32)__U,
80 (__v32bf)_mm512_cvtne2ps_pbh(__A, __B),
81 (__v32bf)__W);
8082}
8183
8284/// Convert Two Packed Single Data to One Packed BF16 Data.
......@@ -96,9 +98,9 @@ _mm512_mask_cvtne2ps_pbh(__m512bh __W, __mmask32 __U, __m512 __A, __m512 __B) {
9698/// conversion of __B, and higher 256 bits come from conversion of __A.
9799static __inline__ __m512bh __DEFAULT_FN_ATTRS512
98100_mm512_maskz_cvtne2ps_pbh(__mmask32 __U, __m512 __A, __m512 __B) {
99 return (__m512bh)__builtin_ia32_selectw_512((__mmask32)__U,
100 (__v32hi)_mm512_cvtne2ps_pbh(__A, __B),
101 (__v32hi)_mm512_setzero_si512());
101 return (__m512bh)__builtin_ia32_selectpbf_512((__mmask32)__U,
102 (__v32bf)_mm512_cvtne2ps_pbh(__A, __B),
103 (__v32bf)_mm512_setzero_si512());
102104}
103105
104106/// Convert Packed Single Data to Packed BF16 Data.
......@@ -113,7 +115,7 @@ _mm512_maskz_cvtne2ps_pbh(__mmask32 __U, __m512 __A, __m512 __B) {
113115static __inline__ __m256bh __DEFAULT_FN_ATTRS512
114116_mm512_cvtneps_pbh(__m512 __A) {
115117 return (__m256bh)__builtin_ia32_cvtneps2bf16_512_mask((__v16sf)__A,
116 (__v16hi)_mm256_undefined_si256(),
118 (__v16bf)_mm256_undefined_si256(),
117119 (__mmask16)-1);
118120}
119121
......@@ -134,7 +136,7 @@ _mm512_cvtneps_pbh(__m512 __A) {
134136static __inline__ __m256bh __DEFAULT_FN_ATTRS512
135137_mm512_mask_cvtneps_pbh(__m256bh __W, __mmask16 __U, __m512 __A) {
136138 return (__m256bh)__builtin_ia32_cvtneps2bf16_512_mask((__v16sf)__A,
137 (__v16hi)__W,
139 (__v16bf)__W,
138140 (__mmask16)__U);
139141}
140142
......@@ -153,7 +155,7 @@ _mm512_mask_cvtneps_pbh(__m256bh __W, __mmask16 __U, __m512 __A) {
153155static __inline__ __m256bh __DEFAULT_FN_ATTRS512
154156_mm512_maskz_cvtneps_pbh(__mmask16 __U, __m512 __A) {
155157 return (__m256bh)__builtin_ia32_cvtneps2bf16_512_mask((__v16sf)__A,
156 (__v16hi)_mm256_setzero_si256(),
158 (__v16bf)_mm256_setzero_si256(),
157159 (__mmask16)__U);
158160}
159161
......@@ -174,8 +176,8 @@ _mm512_maskz_cvtneps_pbh(__mmask16 __U, __m512 __A) {
174176static __inline__ __m512 __DEFAULT_FN_ATTRS512
175177_mm512_dpbf16_ps(__m512 __D, __m512bh __A, __m512bh __B) {
176178 return (__m512)__builtin_ia32_dpbf16ps_512((__v16sf) __D,
177 (__v16si) __A,
178 (__v16si) __B);
179 (__v32bf) __A,
180 (__v32bf) __B);
179181}
180182
181183/// Dot Product of BF16 Pairs Accumulated into Packed Single Precision.
......@@ -277,3 +279,4 @@ _mm512_mask_cvtpbh_ps(__m512 __S, __mmask16 __U, __m256bh __A) {
277279#undef __DEFAULT_FN_ATTRS512
278280
279281#endif
282#endif
lib/include/avx512fintrin.h+2-2
......@@ -256,8 +256,8 @@ _mm512_maskz_broadcastq_epi64 (__mmask8 __M, __m128i __A)
256256static __inline __m512 __DEFAULT_FN_ATTRS512
257257_mm512_setzero_ps(void)
258258{
259 return __extension__ (__m512){ 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.0,
260 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.0 };
259 return __extension__ (__m512){ 0.0f, 0.0f, 0.0f, 0.0f, 0.0f, 0.0f, 0.0f, 0.0f,
260 0.0f, 0.0f, 0.0f, 0.0f, 0.0f, 0.0f, 0.0f, 0.0f };
261261}
262262
263263#define _mm512_setzero _mm512_setzero_ps
lib/include/avx512fp16intrin.h+6-9
......@@ -10,6 +10,8 @@
1010#error "Never use <avx512fp16intrin.h> directly; include <immintrin.h> instead."
1111#endif
1212
13#ifdef __SSE2__
14
1315#ifndef __AVX512FP16INTRIN_H
1416#define __AVX512FP16INTRIN_H
1517
......@@ -17,12 +19,6 @@
1719typedef _Float16 __v32hf __attribute__((__vector_size__(64), __aligned__(64)));
1820typedef _Float16 __m512h __attribute__((__vector_size__(64), __aligned__(64)));
1921typedef _Float16 __m512h_u __attribute__((__vector_size__(64), __aligned__(1)));
20typedef _Float16 __v8hf __attribute__((__vector_size__(16), __aligned__(16)));
21typedef _Float16 __m128h __attribute__((__vector_size__(16), __aligned__(16)));
22typedef _Float16 __m128h_u __attribute__((__vector_size__(16), __aligned__(1)));
23typedef _Float16 __v16hf __attribute__((__vector_size__(32), __aligned__(32)));
24typedef _Float16 __m256h __attribute__((__vector_size__(32), __aligned__(32)));
25typedef _Float16 __m256h_u __attribute__((__vector_size__(32), __aligned__(1)));
2622
2723/* Define the default attributes for the functions in this file. */
2824#define __DEFAULT_FN_ATTRS512 \
......@@ -829,7 +825,7 @@ static __inline__ __m128h __DEFAULT_FN_ATTRS128 _mm_load_sh(void const *__dp) {
829825 struct __mm_load_sh_struct {
830826 _Float16 __u;
831827 } __attribute__((__packed__, __may_alias__));
832 _Float16 __u = ((struct __mm_load_sh_struct *)__dp)->__u;
828 _Float16 __u = ((const struct __mm_load_sh_struct *)__dp)->__u;
833829 return (__m128h){__u, 0, 0, 0, 0, 0, 0, 0};
834830}
835831
......@@ -838,13 +834,13 @@ _mm_mask_load_sh(__m128h __W, __mmask8 __U, const void *__A) {
838834 __m128h src = (__v8hf)__builtin_shufflevector(
839835 (__v8hf)__W, (__v8hf)_mm_setzero_ph(), 0, 8, 8, 8, 8, 8, 8, 8);
840836
841 return (__m128h)__builtin_ia32_loadsh128_mask((__v8hf *)__A, src, __U & 1);
837 return (__m128h)__builtin_ia32_loadsh128_mask((const __v8hf *)__A, src, __U & 1);
842838}
843839
844840static __inline__ __m128h __DEFAULT_FN_ATTRS128
845841_mm_maskz_load_sh(__mmask8 __U, const void *__A) {
846842 return (__m128h)__builtin_ia32_loadsh128_mask(
847 (__v8hf *)__A, (__v8hf)_mm_setzero_ph(), __U & 1);
843 (const __v8hf *)__A, (__v8hf)_mm_setzero_ph(), __U & 1);
848844}
849845
850846static __inline__ __m512h __DEFAULT_FN_ATTRS512
......@@ -3347,3 +3343,4 @@ _mm512_permutexvar_ph(__m512i __A, __m512h __B) {
33473343#undef __DEFAULT_FN_ATTRS512
33483344
33493345#endif
3346#endif
lib/include/avx512ifmavlintrin.h+13-27
......@@ -18,14 +18,21 @@
1818#define __DEFAULT_FN_ATTRS128 __attribute__((__always_inline__, __nodebug__, __target__("avx512ifma,avx512vl"), __min_vector_width__(128)))
1919#define __DEFAULT_FN_ATTRS256 __attribute__((__always_inline__, __nodebug__, __target__("avx512ifma,avx512vl"), __min_vector_width__(256)))
2020
21#define _mm_madd52hi_epu64(X, Y, Z) \
22 ((__m128i)__builtin_ia32_vpmadd52huq128((__v2di)(X), (__v2di)(Y), \
23 (__v2di)(Z)))
2124
25#define _mm256_madd52hi_epu64(X, Y, Z) \
26 ((__m256i)__builtin_ia32_vpmadd52huq256((__v4di)(X), (__v4di)(Y), \
27 (__v4di)(Z)))
2228
23static __inline__ __m128i __DEFAULT_FN_ATTRS128
24_mm_madd52hi_epu64 (__m128i __X, __m128i __Y, __m128i __Z)
25{
26 return (__m128i)__builtin_ia32_vpmadd52huq128((__v2di) __X, (__v2di) __Y,
27 (__v2di) __Z);
28}
29#define _mm_madd52lo_epu64(X, Y, Z) \
30 ((__m128i)__builtin_ia32_vpmadd52luq128((__v2di)(X), (__v2di)(Y), \
31 (__v2di)(Z)))
32
33#define _mm256_madd52lo_epu64(X, Y, Z) \
34 ((__m256i)__builtin_ia32_vpmadd52luq256((__v4di)(X), (__v4di)(Y), \
35 (__v4di)(Z)))
2936
3037static __inline__ __m128i __DEFAULT_FN_ATTRS128
3138_mm_mask_madd52hi_epu64 (__m128i __W, __mmask8 __M, __m128i __X, __m128i __Y)
......@@ -43,13 +50,6 @@ _mm_maskz_madd52hi_epu64 (__mmask8 __M, __m128i __X, __m128i __Y, __m128i __Z)
4350 (__v2di)_mm_setzero_si128());
4451}
4552
46static __inline__ __m256i __DEFAULT_FN_ATTRS256
47_mm256_madd52hi_epu64 (__m256i __X, __m256i __Y, __m256i __Z)
48{
49 return (__m256i)__builtin_ia32_vpmadd52huq256((__v4di)__X, (__v4di)__Y,
50 (__v4di)__Z);
51}
52
5353static __inline__ __m256i __DEFAULT_FN_ATTRS256
5454_mm256_mask_madd52hi_epu64 (__m256i __W, __mmask8 __M, __m256i __X, __m256i __Y)
5555{
......@@ -66,13 +66,6 @@ _mm256_maskz_madd52hi_epu64 (__mmask8 __M, __m256i __X, __m256i __Y, __m256i __Z
6666 (__v4di)_mm256_setzero_si256());
6767}
6868
69static __inline__ __m128i __DEFAULT_FN_ATTRS128
70_mm_madd52lo_epu64 (__m128i __X, __m128i __Y, __m128i __Z)
71{
72 return (__m128i)__builtin_ia32_vpmadd52luq128((__v2di)__X, (__v2di)__Y,
73 (__v2di)__Z);
74}
75
7669static __inline__ __m128i __DEFAULT_FN_ATTRS128
7770_mm_mask_madd52lo_epu64 (__m128i __W, __mmask8 __M, __m128i __X, __m128i __Y)
7871{
......@@ -89,13 +82,6 @@ _mm_maskz_madd52lo_epu64 (__mmask8 __M, __m128i __X, __m128i __Y, __m128i __Z)
8982 (__v2di)_mm_setzero_si128());
9083}
9184
92static __inline__ __m256i __DEFAULT_FN_ATTRS256
93_mm256_madd52lo_epu64 (__m256i __X, __m256i __Y, __m256i __Z)
94{
95 return (__m256i)__builtin_ia32_vpmadd52luq256((__v4di)__X, (__v4di)__Y,
96 (__v4di)__Z);
97}
98
9985static __inline__ __m256i __DEFAULT_FN_ATTRS256
10086_mm256_mask_madd52lo_epu64 (__m256i __W, __mmask8 __M, __m256i __X, __m256i __Y)
10187{
lib/include/avx512vlbf16intrin.h+31-38
......@@ -10,11 +10,11 @@
1010#error "Never use <avx512vlbf16intrin.h> directly; include <immintrin.h> instead."
1111#endif
1212
13#ifdef __SSE2__
14
1315#ifndef __AVX512VLBF16INTRIN_H
1416#define __AVX512VLBF16INTRIN_H
1517
16typedef short __m128bh __attribute__((__vector_size__(16), __aligned__(16)));
17
1818#define __DEFAULT_FN_ATTRS128 \
1919 __attribute__((__always_inline__, __nodebug__, \
2020 __target__("avx512vl, avx512bf16"), __min_vector_width__(128)))
......@@ -59,9 +59,9 @@ _mm_cvtne2ps_pbh(__m128 __A, __m128 __B) {
5959/// conversion of __B, and higher 64 bits come from conversion of __A.
6060static __inline__ __m128bh __DEFAULT_FN_ATTRS128
6161_mm_mask_cvtne2ps_pbh(__m128bh __W, __mmask8 __U, __m128 __A, __m128 __B) {
62 return (__m128bh)__builtin_ia32_selectw_128((__mmask8)__U,
63 (__v8hi)_mm_cvtne2ps_pbh(__A, __B),
64 (__v8hi)__W);
62 return (__m128bh)__builtin_ia32_selectpbf_128((__mmask8)__U,
63 (__v8bf)_mm_cvtne2ps_pbh(__A, __B),
64 (__v8bf)__W);
6565}
6666
6767/// Convert Two Packed Single Data to One Packed BF16 Data.
......@@ -81,9 +81,9 @@ _mm_mask_cvtne2ps_pbh(__m128bh __W, __mmask8 __U, __m128 __A, __m128 __B) {
8181/// conversion of __B, and higher 64 bits come from conversion of __A.
8282static __inline__ __m128bh __DEFAULT_FN_ATTRS128
8383_mm_maskz_cvtne2ps_pbh(__mmask8 __U, __m128 __A, __m128 __B) {
84 return (__m128bh)__builtin_ia32_selectw_128((__mmask8)__U,
85 (__v8hi)_mm_cvtne2ps_pbh(__A, __B),
86 (__v8hi)_mm_setzero_si128());
84 return (__m128bh)__builtin_ia32_selectpbf_128((__mmask8)__U,
85 (__v8bf)_mm_cvtne2ps_pbh(__A, __B),
86 (__v8bf)_mm_setzero_si128());
8787}
8888
8989/// Convert Two Packed Single Data to One Packed BF16 Data.
......@@ -123,9 +123,9 @@ _mm256_cvtne2ps_pbh(__m256 __A, __m256 __B) {
123123/// conversion of __B, and higher 128 bits come from conversion of __A.
124124static __inline__ __m256bh __DEFAULT_FN_ATTRS256
125125_mm256_mask_cvtne2ps_pbh(__m256bh __W, __mmask16 __U, __m256 __A, __m256 __B) {
126 return (__m256bh)__builtin_ia32_selectw_256((__mmask16)__U,
127 (__v16hi)_mm256_cvtne2ps_pbh(__A, __B),
128 (__v16hi)__W);
126 return (__m256bh)__builtin_ia32_selectpbf_256((__mmask16)__U,
127 (__v16bf)_mm256_cvtne2ps_pbh(__A, __B),
128 (__v16bf)__W);
129129}
130130
131131/// Convert Two Packed Single Data to One Packed BF16 Data.
......@@ -145,9 +145,9 @@ _mm256_mask_cvtne2ps_pbh(__m256bh __W, __mmask16 __U, __m256 __A, __m256 __B) {
145145/// conversion of __B, and higher 128 bits come from conversion of __A.
146146static __inline__ __m256bh __DEFAULT_FN_ATTRS256
147147_mm256_maskz_cvtne2ps_pbh(__mmask16 __U, __m256 __A, __m256 __B) {
148 return (__m256bh)__builtin_ia32_selectw_256((__mmask16)__U,
149 (__v16hi)_mm256_cvtne2ps_pbh(__A, __B),
150 (__v16hi)_mm256_setzero_si256());
148 return (__m256bh)__builtin_ia32_selectpbf_256((__mmask16)__U,
149 (__v16bf)_mm256_cvtne2ps_pbh(__A, __B),
150 (__v16bf)_mm256_setzero_si256());
151151}
152152
153153/// Convert Packed Single Data to Packed BF16 Data.
......@@ -160,12 +160,8 @@ _mm256_maskz_cvtne2ps_pbh(__mmask16 __U, __m256 __A, __m256 __B) {
160160/// A 128-bit vector of [4 x float].
161161/// \returns A 128-bit vector of [8 x bfloat] whose lower 64 bits come from
162162/// conversion of __A, and higher 64 bits are 0.
163static __inline__ __m128bh __DEFAULT_FN_ATTRS128
164_mm_cvtneps_pbh(__m128 __A) {
165 return (__m128bh)__builtin_ia32_cvtneps2bf16_128_mask((__v4sf) __A,
166 (__v8hi)_mm_undefined_si128(),
167 (__mmask8)-1);
168}
163#define _mm_cvtneps_pbh(A) \
164 ((__m128bh)__builtin_ia32_vcvtneps2bf16128((__v4sf)(A)))
169165
170166/// Convert Packed Single Data to Packed BF16 Data.
171167///
......@@ -185,7 +181,7 @@ _mm_cvtneps_pbh(__m128 __A) {
185181static __inline__ __m128bh __DEFAULT_FN_ATTRS128
186182_mm_mask_cvtneps_pbh(__m128bh __W, __mmask8 __U, __m128 __A) {
187183 return (__m128bh)__builtin_ia32_cvtneps2bf16_128_mask((__v4sf) __A,
188 (__v8hi)__W,
184 (__v8bf)__W,
189185 (__mmask8)__U);
190186}
191187
......@@ -205,7 +201,7 @@ _mm_mask_cvtneps_pbh(__m128bh __W, __mmask8 __U, __m128 __A) {
205201static __inline__ __m128bh __DEFAULT_FN_ATTRS128
206202_mm_maskz_cvtneps_pbh(__mmask8 __U, __m128 __A) {
207203 return (__m128bh)__builtin_ia32_cvtneps2bf16_128_mask((__v4sf) __A,
208 (__v8hi)_mm_setzero_si128(),
204 (__v8bf)_mm_setzero_si128(),
209205 (__mmask8)__U);
210206}
211207
......@@ -218,12 +214,8 @@ _mm_maskz_cvtneps_pbh(__mmask8 __U, __m128 __A) {
218214/// \param __A
219215/// A 256-bit vector of [8 x float].
220216/// \returns A 128-bit vector of [8 x bfloat] comes from conversion of __A.
221static __inline__ __m128bh __DEFAULT_FN_ATTRS256
222_mm256_cvtneps_pbh(__m256 __A) {
223 return (__m128bh)__builtin_ia32_cvtneps2bf16_256_mask((__v8sf)__A,
224 (__v8hi)_mm_undefined_si128(),
225 (__mmask8)-1);
226}
217#define _mm256_cvtneps_pbh(A) \
218 ((__m128bh)__builtin_ia32_vcvtneps2bf16256((__v8sf)(A)))
227219
228220/// Convert Packed Single Data to Packed BF16 Data.
229221///
......@@ -242,7 +234,7 @@ _mm256_cvtneps_pbh(__m256 __A) {
242234static __inline__ __m128bh __DEFAULT_FN_ATTRS256
243235_mm256_mask_cvtneps_pbh(__m128bh __W, __mmask8 __U, __m256 __A) {
244236 return (__m128bh)__builtin_ia32_cvtneps2bf16_256_mask((__v8sf)__A,
245 (__v8hi)__W,
237 (__v8bf)__W,
246238 (__mmask8)__U);
247239}
248240
......@@ -261,7 +253,7 @@ _mm256_mask_cvtneps_pbh(__m128bh __W, __mmask8 __U, __m256 __A) {
261253static __inline__ __m128bh __DEFAULT_FN_ATTRS256
262254_mm256_maskz_cvtneps_pbh(__mmask8 __U, __m256 __A) {
263255 return (__m128bh)__builtin_ia32_cvtneps2bf16_256_mask((__v8sf)__A,
264 (__v8hi)_mm_setzero_si128(),
256 (__v8bf)_mm_setzero_si128(),
265257 (__mmask8)__U);
266258}
267259
......@@ -282,8 +274,8 @@ _mm256_maskz_cvtneps_pbh(__mmask8 __U, __m256 __A) {
282274static __inline__ __m128 __DEFAULT_FN_ATTRS128
283275_mm_dpbf16_ps(__m128 __D, __m128bh __A, __m128bh __B) {
284276 return (__m128)__builtin_ia32_dpbf16ps_128((__v4sf)__D,
285 (__v4si)__A,
286 (__v4si)__B);
277 (__v8bf)__A,
278 (__v8bf)__B);
287279}
288280
289281/// Dot Product of BF16 Pairs Accumulated into Packed Single Precision.
......@@ -351,8 +343,8 @@ _mm_maskz_dpbf16_ps(__mmask8 __U, __m128 __D, __m128bh __A, __m128bh __B) {
351343static __inline__ __m256 __DEFAULT_FN_ATTRS256
352344_mm256_dpbf16_ps(__m256 __D, __m256bh __A, __m256bh __B) {
353345 return (__m256)__builtin_ia32_dpbf16ps_256((__v8sf)__D,
354 (__v8si)__A,
355 (__v8si)__B);
346 (__v16bf)__A,
347 (__v16bf)__B);
356348}
357349
358350/// Dot Product of BF16 Pairs Accumulated into Packed Single Precision.
......@@ -413,11 +405,11 @@ _mm256_maskz_dpbf16_ps(__mmask8 __U, __m256 __D, __m256bh __A, __m256bh __B) {
413405/// A float data.
414406/// \returns A bf16 data whose sign field and exponent field keep unchanged,
415407/// and fraction field is truncated to 7 bits.
416static __inline__ __bfloat16 __DEFAULT_FN_ATTRS128 _mm_cvtness_sbh(float __A) {
408static __inline__ __bf16 __DEFAULT_FN_ATTRS128 _mm_cvtness_sbh(float __A) {
417409 __v4sf __V = {__A, 0, 0, 0};
418 __v8hi __R = __builtin_ia32_cvtneps2bf16_128_mask(
419 (__v4sf)__V, (__v8hi)_mm_undefined_si128(), (__mmask8)-1);
420 return (__bfloat16)__R[0];
410 __v8bf __R = __builtin_ia32_cvtneps2bf16_128_mask(
411 (__v4sf)__V, (__v8bf)_mm_undefined_si128(), (__mmask8)-1);
412 return (__bf16)__R[0];
421413}
422414
423415/// Convert Packed BF16 Data to Packed float Data.
......@@ -520,3 +512,4 @@ _mm256_mask_cvtpbh_ps(__m256 __S, __mmask8 __U, __m128bh __A) {
520512#undef __DEFAULT_FN_ATTRS256
521513
522514#endif
515#endif
lib/include/avx512vlbwintrin.h+352
......@@ -2803,6 +2803,358 @@ _mm256_mask_permutexvar_epi16 (__m256i __W, __mmask16 __M, __m256i __A,
28032803 (__v16hi)_mm256_dbsad_epu8((A), (B), (imm)), \
28042804 (__v16hi)_mm256_setzero_si256()))
28052805
2806static __inline__ short __DEFAULT_FN_ATTRS128
2807_mm_reduce_add_epi16(__m128i __W) {
2808 return __builtin_reduce_add((__v8hi)__W);
2809}
2810
2811static __inline__ short __DEFAULT_FN_ATTRS128
2812_mm_reduce_mul_epi16(__m128i __W) {
2813 return __builtin_reduce_mul((__v8hi)__W);
2814}
2815
2816static __inline__ short __DEFAULT_FN_ATTRS128
2817_mm_reduce_and_epi16(__m128i __W) {
2818 return __builtin_reduce_and((__v8hi)__W);
2819}
2820
2821static __inline__ short __DEFAULT_FN_ATTRS128
2822_mm_reduce_or_epi16(__m128i __W) {
2823 return __builtin_reduce_or((__v8hi)__W);
2824}
2825
2826static __inline__ short __DEFAULT_FN_ATTRS128
2827_mm_mask_reduce_add_epi16( __mmask8 __M, __m128i __W) {
2828 __W = _mm_maskz_mov_epi16(__M, __W);
2829 return __builtin_reduce_add((__v8hi)__W);
2830}
2831
2832static __inline__ short __DEFAULT_FN_ATTRS128
2833_mm_mask_reduce_mul_epi16( __mmask8 __M, __m128i __W) {
2834 __W = _mm_mask_mov_epi16(_mm_set1_epi16(1), __M, __W);
2835 return __builtin_reduce_mul((__v8hi)__W);
2836}
2837
2838static __inline__ short __DEFAULT_FN_ATTRS128
2839_mm_mask_reduce_and_epi16( __mmask8 __M, __m128i __W) {
2840 __W = _mm_mask_mov_epi16(_mm_set1_epi16(-1), __M, __W);
2841 return __builtin_reduce_and((__v8hi)__W);
2842}
2843
2844static __inline__ short __DEFAULT_FN_ATTRS128
2845_mm_mask_reduce_or_epi16(__mmask8 __M, __m128i __W) {
2846 __W = _mm_maskz_mov_epi16(__M, __W);
2847 return __builtin_reduce_or((__v8hi)__W);
2848}
2849
2850static __inline__ short __DEFAULT_FN_ATTRS128
2851_mm_reduce_max_epi16(__m128i __V) {
2852 return __builtin_reduce_max((__v8hi)__V);
2853}
2854
2855static __inline__ unsigned short __DEFAULT_FN_ATTRS128
2856_mm_reduce_max_epu16(__m128i __V) {
2857 return __builtin_reduce_max((__v8hu)__V);
2858}
2859
2860static __inline__ short __DEFAULT_FN_ATTRS128
2861_mm_reduce_min_epi16(__m128i __V) {
2862 return __builtin_reduce_min((__v8hi)__V);
2863}
2864
2865static __inline__ unsigned short __DEFAULT_FN_ATTRS128
2866_mm_reduce_min_epu16(__m128i __V) {
2867 return __builtin_reduce_min((__v8hu)__V);
2868}
2869
2870static __inline__ short __DEFAULT_FN_ATTRS128
2871_mm_mask_reduce_max_epi16(__mmask16 __M, __m128i __V) {
2872 __V = _mm_mask_mov_epi16(_mm_set1_epi16(-32767-1), __M, __V);
2873 return __builtin_reduce_max((__v8hi)__V);
2874}
2875
2876static __inline__ unsigned short __DEFAULT_FN_ATTRS128
2877_mm_mask_reduce_max_epu16(__mmask16 __M, __m128i __V) {
2878 __V = _mm_maskz_mov_epi16(__M, __V);
2879 return __builtin_reduce_max((__v8hu)__V);
2880}
2881
2882static __inline__ short __DEFAULT_FN_ATTRS128
2883_mm_mask_reduce_min_epi16(__mmask16 __M, __m128i __V) {
2884 __V = _mm_mask_mov_epi16(_mm_set1_epi16(32767), __M, __V);
2885 return __builtin_reduce_min((__v8hi)__V);
2886}
2887
2888static __inline__ unsigned short __DEFAULT_FN_ATTRS128
2889_mm_mask_reduce_min_epu16(__mmask16 __M, __m128i __V) {
2890 __V = _mm_mask_mov_epi16(_mm_set1_epi16(-1), __M, __V);
2891 return __builtin_reduce_min((__v8hu)__V);
2892}
2893
2894static __inline__ short __DEFAULT_FN_ATTRS256
2895_mm256_reduce_add_epi16(__m256i __W) {
2896 return __builtin_reduce_add((__v16hi)__W);
2897}
2898
2899static __inline__ short __DEFAULT_FN_ATTRS256
2900_mm256_reduce_mul_epi16(__m256i __W) {
2901 return __builtin_reduce_mul((__v16hi)__W);
2902}
2903
2904static __inline__ short __DEFAULT_FN_ATTRS256
2905_mm256_reduce_and_epi16(__m256i __W) {
2906 return __builtin_reduce_and((__v16hi)__W);
2907}
2908
2909static __inline__ short __DEFAULT_FN_ATTRS256
2910_mm256_reduce_or_epi16(__m256i __W) {
2911 return __builtin_reduce_or((__v16hi)__W);
2912}
2913
2914static __inline__ short __DEFAULT_FN_ATTRS256
2915_mm256_mask_reduce_add_epi16( __mmask16 __M, __m256i __W) {
2916 __W = _mm256_maskz_mov_epi16(__M, __W);
2917 return __builtin_reduce_add((__v16hi)__W);
2918}
2919
2920static __inline__ short __DEFAULT_FN_ATTRS256
2921_mm256_mask_reduce_mul_epi16( __mmask16 __M, __m256i __W) {
2922 __W = _mm256_mask_mov_epi16(_mm256_set1_epi16(1), __M, __W);
2923 return __builtin_reduce_mul((__v16hi)__W);
2924}
2925
2926static __inline__ short __DEFAULT_FN_ATTRS256
2927_mm256_mask_reduce_and_epi16( __mmask16 __M, __m256i __W) {
2928 __W = _mm256_mask_mov_epi16(_mm256_set1_epi16(-1), __M, __W);
2929 return __builtin_reduce_and((__v16hi)__W);
2930}
2931
2932static __inline__ short __DEFAULT_FN_ATTRS256
2933_mm256_mask_reduce_or_epi16(__mmask16 __M, __m256i __W) {
2934 __W = _mm256_maskz_mov_epi16(__M, __W);
2935 return __builtin_reduce_or((__v16hi)__W);
2936}
2937
2938static __inline__ short __DEFAULT_FN_ATTRS256
2939_mm256_reduce_max_epi16(__m256i __V) {
2940 return __builtin_reduce_max((__v16hi)__V);
2941}
2942
2943static __inline__ unsigned short __DEFAULT_FN_ATTRS256
2944_mm256_reduce_max_epu16(__m256i __V) {
2945 return __builtin_reduce_max((__v16hu)__V);
2946}
2947
2948static __inline__ short __DEFAULT_FN_ATTRS256
2949_mm256_reduce_min_epi16(__m256i __V) {
2950 return __builtin_reduce_min((__v16hi)__V);
2951}
2952
2953static __inline__ unsigned short __DEFAULT_FN_ATTRS256
2954_mm256_reduce_min_epu16(__m256i __V) {
2955 return __builtin_reduce_min((__v16hu)__V);
2956}
2957
2958static __inline__ short __DEFAULT_FN_ATTRS256
2959_mm256_mask_reduce_max_epi16(__mmask16 __M, __m256i __V) {
2960 __V = _mm256_mask_mov_epi16(_mm256_set1_epi16(-32767-1), __M, __V);
2961 return __builtin_reduce_max((__v16hi)__V);
2962}
2963
2964static __inline__ unsigned short __DEFAULT_FN_ATTRS256
2965_mm256_mask_reduce_max_epu16(__mmask16 __M, __m256i __V) {
2966 __V = _mm256_maskz_mov_epi16(__M, __V);
2967 return __builtin_reduce_max((__v16hu)__V);
2968}
2969
2970static __inline__ short __DEFAULT_FN_ATTRS256
2971_mm256_mask_reduce_min_epi16(__mmask16 __M, __m256i __V) {
2972 __V = _mm256_mask_mov_epi16(_mm256_set1_epi16(32767), __M, __V);
2973 return __builtin_reduce_min((__v16hi)__V);
2974}
2975
2976static __inline__ unsigned short __DEFAULT_FN_ATTRS256
2977_mm256_mask_reduce_min_epu16(__mmask16 __M, __m256i __V) {
2978 __V = _mm256_mask_mov_epi16(_mm256_set1_epi16(-1), __M, __V);
2979 return __builtin_reduce_min((__v16hu)__V);
2980}
2981
2982static __inline__ signed char __DEFAULT_FN_ATTRS128
2983_mm_reduce_add_epi8(__m128i __W) {
2984 return __builtin_reduce_add((__v16qs)__W);
2985}
2986
2987static __inline__ signed char __DEFAULT_FN_ATTRS128
2988_mm_reduce_mul_epi8(__m128i __W) {
2989 return __builtin_reduce_mul((__v16qs)__W);
2990}
2991
2992static __inline__ signed char __DEFAULT_FN_ATTRS128
2993_mm_reduce_and_epi8(__m128i __W) {
2994 return __builtin_reduce_and((__v16qs)__W);
2995}
2996
2997static __inline__ signed char __DEFAULT_FN_ATTRS128
2998_mm_reduce_or_epi8(__m128i __W) {
2999 return __builtin_reduce_or((__v16qs)__W);
3000}
3001
3002static __inline__ signed char __DEFAULT_FN_ATTRS128
3003_mm_mask_reduce_add_epi8(__mmask16 __M, __m128i __W) {
3004 __W = _mm_maskz_mov_epi8(__M, __W);
3005 return __builtin_reduce_add((__v16qs)__W);
3006}
3007
3008static __inline__ signed char __DEFAULT_FN_ATTRS128
3009_mm_mask_reduce_mul_epi8(__mmask16 __M, __m128i __W) {
3010 __W = _mm_mask_mov_epi8(_mm_set1_epi8(1), __M, __W);
3011 return __builtin_reduce_mul((__v16qs)__W);
3012}
3013
3014static __inline__ signed char __DEFAULT_FN_ATTRS128
3015_mm_mask_reduce_and_epi8(__mmask16 __M, __m128i __W) {
3016 __W = _mm_mask_mov_epi8(_mm_set1_epi8(-1), __M, __W);
3017 return __builtin_reduce_and((__v16qs)__W);
3018}
3019
3020static __inline__ signed char __DEFAULT_FN_ATTRS128
3021_mm_mask_reduce_or_epi8(__mmask16 __M, __m128i __W) {
3022 __W = _mm_maskz_mov_epi8(__M, __W);
3023 return __builtin_reduce_or((__v16qs)__W);
3024}
3025
3026static __inline__ signed char __DEFAULT_FN_ATTRS128
3027_mm_reduce_max_epi8(__m128i __V) {
3028 return __builtin_reduce_max((__v16qs)__V);
3029}
3030
3031static __inline__ unsigned char __DEFAULT_FN_ATTRS128
3032_mm_reduce_max_epu8(__m128i __V) {
3033 return __builtin_reduce_max((__v16qu)__V);
3034}
3035
3036static __inline__ signed char __DEFAULT_FN_ATTRS128
3037_mm_reduce_min_epi8(__m128i __V) {
3038 return __builtin_reduce_min((__v16qs)__V);
3039}
3040
3041static __inline__ unsigned char __DEFAULT_FN_ATTRS128
3042_mm_reduce_min_epu8(__m128i __V) {
3043 return __builtin_reduce_min((__v16qu)__V);
3044}
3045
3046static __inline__ signed char __DEFAULT_FN_ATTRS128
3047_mm_mask_reduce_max_epi8(__mmask16 __M, __m128i __V) {
3048 __V = _mm_mask_mov_epi8(_mm_set1_epi8(-127-1), __M, __V);
3049 return __builtin_reduce_max((__v16qs)__V);
3050}
3051
3052static __inline__ unsigned char __DEFAULT_FN_ATTRS128
3053_mm_mask_reduce_max_epu8(__mmask16 __M, __m128i __V) {
3054 __V = _mm_maskz_mov_epi8(__M, __V);
3055 return __builtin_reduce_max((__v16qu)__V);
3056}
3057
3058static __inline__ signed char __DEFAULT_FN_ATTRS128
3059_mm_mask_reduce_min_epi8(__mmask16 __M, __m128i __V) {
3060 __V = _mm_mask_mov_epi8(_mm_set1_epi8(127), __M, __V);
3061 return __builtin_reduce_min((__v16qs)__V);
3062}
3063
3064static __inline__ unsigned char __DEFAULT_FN_ATTRS128
3065_mm_mask_reduce_min_epu8(__mmask16 __M, __m128i __V) {
3066 __V = _mm_mask_mov_epi8(_mm_set1_epi8(-1), __M, __V);
3067 return __builtin_reduce_min((__v16qu)__V);
3068}
3069
3070static __inline__ signed char __DEFAULT_FN_ATTRS256
3071_mm256_reduce_add_epi8(__m256i __W) {
3072 return __builtin_reduce_add((__v32qs)__W);
3073}
3074
3075static __inline__ signed char __DEFAULT_FN_ATTRS256
3076_mm256_reduce_mul_epi8(__m256i __W) {
3077 return __builtin_reduce_mul((__v32qs)__W);
3078}
3079
3080static __inline__ signed char __DEFAULT_FN_ATTRS256
3081_mm256_reduce_and_epi8(__m256i __W) {
3082 return __builtin_reduce_and((__v32qs)__W);
3083}
3084
3085static __inline__ signed char __DEFAULT_FN_ATTRS256
3086_mm256_reduce_or_epi8(__m256i __W) {
3087 return __builtin_reduce_or((__v32qs)__W);
3088}
3089
3090static __inline__ signed char __DEFAULT_FN_ATTRS256
3091_mm256_mask_reduce_add_epi8(__mmask32 __M, __m256i __W) {
3092 __W = _mm256_maskz_mov_epi8(__M, __W);
3093 return __builtin_reduce_add((__v32qs)__W);
3094}
3095
3096static __inline__ signed char __DEFAULT_FN_ATTRS256
3097_mm256_mask_reduce_mul_epi8(__mmask32 __M, __m256i __W) {
3098 __W = _mm256_mask_mov_epi8(_mm256_set1_epi8(1), __M, __W);
3099 return __builtin_reduce_mul((__v32qs)__W);
3100}
3101
3102static __inline__ signed char __DEFAULT_FN_ATTRS256
3103_mm256_mask_reduce_and_epi8(__mmask32 __M, __m256i __W) {
3104 __W = _mm256_mask_mov_epi8(_mm256_set1_epi8(-1), __M, __W);
3105 return __builtin_reduce_and((__v32qs)__W);
3106}
3107
3108static __inline__ signed char __DEFAULT_FN_ATTRS256
3109_mm256_mask_reduce_or_epi8(__mmask32 __M, __m256i __W) {
3110 __W = _mm256_maskz_mov_epi8(__M, __W);
3111 return __builtin_reduce_or((__v32qs)__W);
3112}
3113
3114static __inline__ signed char __DEFAULT_FN_ATTRS256
3115_mm256_reduce_max_epi8(__m256i __V) {
3116 return __builtin_reduce_max((__v32qs)__V);
3117}
3118
3119static __inline__ unsigned char __DEFAULT_FN_ATTRS256
3120_mm256_reduce_max_epu8(__m256i __V) {
3121 return __builtin_reduce_max((__v32qu)__V);
3122}
3123
3124static __inline__ signed char __DEFAULT_FN_ATTRS256
3125_mm256_reduce_min_epi8(__m256i __V) {
3126 return __builtin_reduce_min((__v32qs)__V);
3127}
3128
3129static __inline__ unsigned char __DEFAULT_FN_ATTRS256
3130_mm256_reduce_min_epu8(__m256i __V) {
3131 return __builtin_reduce_min((__v32qu)__V);
3132}
3133
3134static __inline__ signed char __DEFAULT_FN_ATTRS256
3135_mm256_mask_reduce_max_epi8(__mmask32 __M, __m256i __V) {
3136 __V = _mm256_mask_mov_epi8(_mm256_set1_epi8(-127-1), __M, __V);
3137 return __builtin_reduce_max((__v32qs)__V);
3138}
3139
3140static __inline__ unsigned char __DEFAULT_FN_ATTRS256
3141_mm256_mask_reduce_max_epu8(__mmask32 __M, __m256i __V) {
3142 __V = _mm256_maskz_mov_epi8(__M, __V);
3143 return __builtin_reduce_max((__v32qu)__V);
3144}
3145
3146static __inline__ signed char __DEFAULT_FN_ATTRS256
3147_mm256_mask_reduce_min_epi8(__mmask32 __M, __m256i __V) {
3148 __V = _mm256_mask_mov_epi8(_mm256_set1_epi8(127), __M, __V);
3149 return __builtin_reduce_min((__v32qs)__V);
3150}
3151
3152static __inline__ unsigned char __DEFAULT_FN_ATTRS256
3153_mm256_mask_reduce_min_epu8(__mmask32 __M, __m256i __V) {
3154 __V = _mm256_mask_mov_epi8(_mm256_set1_epi8(-1), __M, __V);
3155 return __builtin_reduce_min((__v32qu)__V);
3156}
3157
28063158#undef __DEFAULT_FN_ATTRS128
28073159#undef __DEFAULT_FN_ATTRS256
28083160
lib/include/avx512vlfp16intrin.h+3
......@@ -11,6 +11,8 @@
1111 "Never use <avx512vlfp16intrin.h> directly; include <immintrin.h> instead."
1212#endif
1313
14#ifdef __SSE2__
15
1416#ifndef __AVX512VLFP16INTRIN_H
1517#define __AVX512VLFP16INTRIN_H
1618
......@@ -2066,3 +2068,4 @@ _mm_reduce_min_ph(__m128h __V) {
20662068#undef __DEFAULT_FN_ATTRS256
20672069
20682070#endif
2071#endif
lib/include/avxifmaintrin.h created+177
......@@ -0,0 +1,177 @@
1/*===----------------- avxifmaintrin.h - IFMA intrinsics -------------------===
2 *
3 * Part of the LLVM Project, under the Apache License v2.0 with LLVM Exceptions.
4 * See https://llvm.org/LICENSE.txt for license information.
5 * SPDX-License-Identifier: Apache-2.0 WITH LLVM-exception
6 *
7 *===-----------------------------------------------------------------------===
8 */
9
10#ifndef __IMMINTRIN_H
11#error "Never use <avxifmaintrin.h> directly; include <immintrin.h> instead."
12#endif
13
14#ifndef __AVXIFMAINTRIN_H
15#define __AVXIFMAINTRIN_H
16
17/* Define the default attributes for the functions in this file. */
18#define __DEFAULT_FN_ATTRS128 \
19 __attribute__((__always_inline__, __nodebug__, __target__("avxifma"), \
20 __min_vector_width__(128)))
21#define __DEFAULT_FN_ATTRS256 \
22 __attribute__((__always_inline__, __nodebug__, __target__("avxifma"), \
23 __min_vector_width__(256)))
24
25// must vex-encoding
26
27/// Multiply packed unsigned 52-bit integers in each 64-bit element of \a __Y
28/// and \a __Z to form a 104-bit intermediate result. Add the high 52-bit
29/// unsigned integer from the intermediate result with the corresponding
30/// unsigned 64-bit integer in \a __X, and store the results in \a dst.
31///
32/// \headerfile <immintrin.h>
33///
34/// \code
35/// __m128i
36/// _mm_madd52hi_avx_epu64 (__m128i __X, __m128i __Y, __m128i __Z)
37/// \endcode
38///
39/// This intrinsic corresponds to the \c VPMADD52HUQ instruction.
40///
41/// \return
42/// return __m128i dst.
43/// \param __X
44/// A 128-bit vector of [2 x i64]
45/// \param __Y
46/// A 128-bit vector of [2 x i64]
47/// \param __Z
48/// A 128-bit vector of [2 x i64]
49///
50/// \code{.operation}
51/// FOR j := 0 to 1
52/// i := j*64
53/// tmp[127:0] := ZeroExtend64(__Y[i+51:i]) * ZeroExtend64(__Z[i+51:i])
54/// dst[i+63:i] := __X[i+63:i] + ZeroExtend64(tmp[103:52])
55/// ENDFOR
56/// dst[MAX:128] := 0
57/// \endcode
58static __inline__ __m128i __DEFAULT_FN_ATTRS128
59_mm_madd52hi_avx_epu64(__m128i __X, __m128i __Y, __m128i __Z) {
60 return (__m128i)__builtin_ia32_vpmadd52huq128((__v2di)__X, (__v2di)__Y,
61 (__v2di)__Z);
62}
63
64/// Multiply packed unsigned 52-bit integers in each 64-bit element of \a __Y
65/// and \a __Z to form a 104-bit intermediate result. Add the high 52-bit
66/// unsigned integer from the intermediate result with the corresponding
67/// unsigned 64-bit integer in \a __X, and store the results in \a dst.
68///
69/// \headerfile <immintrin.h>
70///
71/// \code
72/// __m256i
73/// _mm256_madd52hi_avx_epu64 (__m256i __X, __m256i __Y, __m256i __Z)
74/// \endcode
75///
76/// This intrinsic corresponds to the \c VPMADD52HUQ instruction.
77///
78/// \return
79/// return __m256i dst.
80/// \param __X
81/// A 256-bit vector of [4 x i64]
82/// \param __Y
83/// A 256-bit vector of [4 x i64]
84/// \param __Z
85/// A 256-bit vector of [4 x i64]
86///
87/// \code{.operation}
88/// FOR j := 0 to 3
89/// i := j*64
90/// tmp[127:0] := ZeroExtend64(__Y[i+51:i]) * ZeroExtend64(__Z[i+51:i])
91/// dst[i+63:i] := __X[i+63:i] + ZeroExtend64(tmp[103:52])
92/// ENDFOR
93/// dst[MAX:256] := 0
94/// \endcode
95static __inline__ __m256i __DEFAULT_FN_ATTRS256
96_mm256_madd52hi_avx_epu64(__m256i __X, __m256i __Y, __m256i __Z) {
97 return (__m256i)__builtin_ia32_vpmadd52huq256((__v4di)__X, (__v4di)__Y,
98 (__v4di)__Z);
99}
100
101/// Multiply packed unsigned 52-bit integers in each 64-bit element of \a __Y
102/// and \a __Z to form a 104-bit intermediate result. Add the low 52-bit
103/// unsigned integer from the intermediate result with the corresponding
104/// unsigned 64-bit integer in \a __X, and store the results in \a dst.
105///
106/// \headerfile <immintrin.h>
107///
108/// \code
109/// __m128i
110/// _mm_madd52lo_avx_epu64 (__m128i __X, __m128i __Y, __m128i __Z)
111/// \endcode
112///
113/// This intrinsic corresponds to the \c VPMADD52LUQ instruction.
114///
115/// \return
116/// return __m128i dst.
117/// \param __X
118/// A 128-bit vector of [2 x i64]
119/// \param __Y
120/// A 128-bit vector of [2 x i64]
121/// \param __Z
122/// A 128-bit vector of [2 x i64]
123///
124/// \code{.operation}
125/// FOR j := 0 to 1
126/// i := j*64
127/// tmp[127:0] := ZeroExtend64(__Y[i+51:i]) * ZeroExtend64(__Z[i+51:i])
128/// dst[i+63:i] := __X[i+63:i] + ZeroExtend64(tmp[51:0])
129/// ENDFOR
130/// dst[MAX:128] := 0
131/// \endcode
132static __inline__ __m128i __DEFAULT_FN_ATTRS128
133_mm_madd52lo_avx_epu64(__m128i __X, __m128i __Y, __m128i __Z) {
134 return (__m128i)__builtin_ia32_vpmadd52luq128((__v2di)__X, (__v2di)__Y,
135 (__v2di)__Z);
136}
137
138/// Multiply packed unsigned 52-bit integers in each 64-bit element of \a __Y
139/// and \a __Z to form a 104-bit intermediate result. Add the low 52-bit
140/// unsigned integer from the intermediate result with the corresponding
141/// unsigned 64-bit integer in \a __X, and store the results in \a dst.
142///
143/// \headerfile <immintrin.h>
144///
145/// \code
146/// __m256i
147/// _mm256_madd52lo_avx_epu64 (__m256i __X, __m256i __Y, __m256i __Z)
148/// \endcode
149///
150/// This intrinsic corresponds to the \c VPMADD52LUQ instruction.
151///
152/// \return
153/// return __m256i dst.
154/// \param __X
155/// A 256-bit vector of [4 x i64]
156/// \param __Y
157/// A 256-bit vector of [4 x i64]
158/// \param __Z
159/// A 256-bit vector of [4 x i64]
160///
161/// \code{.operation}
162/// FOR j := 0 to 3
163/// i := j*64
164/// tmp[127:0] := ZeroExtend64(__Y[i+51:i]) * ZeroExtend64(__Z[i+51:i])
165/// dst[i+63:i] := __X[i+63:i] + ZeroExtend64(tmp[51:0])
166/// ENDFOR
167/// dst[MAX:256] := 0
168/// \endcode
169static __inline__ __m256i __DEFAULT_FN_ATTRS256
170_mm256_madd52lo_avx_epu64(__m256i __X, __m256i __Y, __m256i __Z) {
171 return (__m256i)__builtin_ia32_vpmadd52luq256((__v4di)__X, (__v4di)__Y,
172 (__v4di)__Z);
173}
174#undef __DEFAULT_FN_ATTRS128
175#undef __DEFAULT_FN_ATTRS256
176
177#endif // __AVXIFMAINTRIN_H
lib/include/avxintrin.h+12-2
......@@ -39,6 +39,16 @@ typedef float __m256_u __attribute__ ((__vector_size__ (32), __aligned__(1)));
3939typedef double __m256d_u __attribute__((__vector_size__(32), __aligned__(1)));
4040typedef long long __m256i_u __attribute__((__vector_size__(32), __aligned__(1)));
4141
42#ifdef __SSE2__
43/* Both _Float16 and __bf16 require SSE2 being enabled. */
44typedef _Float16 __v16hf __attribute__((__vector_size__(32), __aligned__(32)));
45typedef _Float16 __m256h __attribute__((__vector_size__(32), __aligned__(32)));
46typedef _Float16 __m256h_u __attribute__((__vector_size__(32), __aligned__(1)));
47
48typedef __bf16 __v16bf __attribute__((__vector_size__(32), __aligned__(32)));
49typedef __bf16 __m256bh __attribute__((__vector_size__(32), __aligned__(32)));
50#endif
51
4252/* Define the default attributes for the functions in this file. */
4353#define __DEFAULT_FN_ATTRS __attribute__((__always_inline__, __nodebug__, __target__("avx"), __min_vector_width__(256)))
4454#define __DEFAULT_FN_ATTRS128 __attribute__((__always_inline__, __nodebug__, __target__("avx"), __min_vector_width__(128)))
......@@ -4288,7 +4298,7 @@ _mm256_set1_epi64x(long long __q)
42884298static __inline __m256d __DEFAULT_FN_ATTRS
42894299_mm256_setzero_pd(void)
42904300{
4291 return __extension__ (__m256d){ 0, 0, 0, 0 };
4301 return __extension__ (__m256d){ 0.0, 0.0, 0.0, 0.0 };
42924302}
42934303
42944304/// Constructs a 256-bit floating-point vector of [8 x float] with all
......@@ -4302,7 +4312,7 @@ _mm256_setzero_pd(void)
43024312static __inline __m256 __DEFAULT_FN_ATTRS
43034313_mm256_setzero_ps(void)
43044314{
4305 return __extension__ (__m256){ 0, 0, 0, 0, 0, 0, 0, 0 };
4315 return __extension__ (__m256){ 0.0f, 0.0f, 0.0f, 0.0f, 0.0f, 0.0f, 0.0f, 0.0f };
43064316}
43074317
43084318/// Constructs a 256-bit integer vector initialized to zero.
lib/include/avxneconvertintrin.h created+484
......@@ -0,0 +1,484 @@
1/*===-------------- avxneconvertintrin.h - AVXNECONVERT --------------------===
2 *
3 * Part of the LLVM Project, under the Apache License v2.0 with LLVM Exceptions.
4 * See https://llvm.org/LICENSE.txt for license information.
5 * SPDX-License-Identifier: Apache-2.0 WITH LLVM-exception
6 *
7 *===-----------------------------------------------------------------------===
8 */
9
10#ifndef __IMMINTRIN_H
11#error \
12 "Never use <avxneconvertintrin.h> directly; include <immintrin.h> instead."
13#endif // __IMMINTRIN_H
14
15#ifdef __SSE2__
16
17#ifndef __AVXNECONVERTINTRIN_H
18#define __AVXNECONVERTINTRIN_H
19
20/* Define the default attributes for the functions in this file. */
21#define __DEFAULT_FN_ATTRS128 \
22 __attribute__((__always_inline__, __nodebug__, __target__("avxneconvert"), \
23 __min_vector_width__(128)))
24#define __DEFAULT_FN_ATTRS256 \
25 __attribute__((__always_inline__, __nodebug__, __target__("avxneconvert"), \
26 __min_vector_width__(256)))
27
28/// Convert scalar BF16 (16-bit) floating-point element
29/// stored at memory locations starting at location \a __A to a
30/// single-precision (32-bit) floating-point, broadcast it to packed
31/// single-precision (32-bit) floating-point elements, and store the results in
32/// \a dst.
33///
34/// \headerfile <x86intrin.h>
35///
36/// \code
37/// _mm_bcstnebf16_ps(const void *__A);
38/// \endcode
39///
40/// This intrinsic corresponds to the \c VBCSTNEBF162PS instruction.
41///
42/// \param __A
43/// A pointer to a 16-bit memory location. The address of the memory
44/// location does not have to be aligned.
45/// \returns
46/// A 128-bit vector of [4 x float].
47///
48/// \code{.operation}
49/// b := Convert_BF16_To_FP32(MEM[__A+15:__A])
50/// FOR j := 0 to 3
51/// m := j*32
52/// dst[m+31:m] := b
53/// ENDFOR
54/// dst[MAX:128] := 0
55/// \endcode
56static __inline__ __m128 __DEFAULT_FN_ATTRS128
57_mm_bcstnebf16_ps(const void *__A) {
58 return (__m128)__builtin_ia32_vbcstnebf162ps128((const __bf16 *)__A);
59}
60
61/// Convert scalar BF16 (16-bit) floating-point element
62/// stored at memory locations starting at location \a __A to a
63/// single-precision (32-bit) floating-point, broadcast it to packed
64/// single-precision (32-bit) floating-point elements, and store the results in
65/// \a dst.
66///
67/// \headerfile <x86intrin.h>
68///
69/// \code
70/// _mm256_bcstnebf16_ps(const void *__A);
71/// \endcode
72///
73/// This intrinsic corresponds to the \c VBCSTNEBF162PS instruction.
74///
75/// \param __A
76/// A pointer to a 16-bit memory location. The address of the memory
77/// location does not have to be aligned.
78/// \returns
79/// A 256-bit vector of [8 x float].
80///
81/// \code{.operation}
82/// b := Convert_BF16_To_FP32(MEM[__A+15:__A])
83/// FOR j := 0 to 7
84/// m := j*32
85/// dst[m+31:m] := b
86/// ENDFOR
87/// dst[MAX:256] := 0
88/// \endcode
89static __inline__ __m256 __DEFAULT_FN_ATTRS256
90_mm256_bcstnebf16_ps(const void *__A) {
91 return (__m256)__builtin_ia32_vbcstnebf162ps256((const __bf16 *)__A);
92}
93
94/// Convert scalar half-precision (16-bit) floating-point element
95/// stored at memory locations starting at location \a __A to a
96/// single-precision (32-bit) floating-point, broadcast it to packed
97/// single-precision (32-bit) floating-point elements, and store the results in
98/// \a dst.
99///
100/// \headerfile <x86intrin.h>
101///
102/// \code
103/// _mm_bcstnesh_ps(const void *__A);
104/// \endcode
105///
106/// This intrinsic corresponds to the \c VBCSTNESH2PS instruction.
107///
108/// \param __A
109/// A pointer to a 16-bit memory location. The address of the memory
110/// location does not have to be aligned.
111/// \returns
112/// A 128-bit vector of [4 x float].
113///
114/// \code{.operation}
115/// b := Convert_FP16_To_FP32(MEM[__A+15:__A])
116/// FOR j := 0 to 3
117/// m := j*32
118/// dst[m+31:m] := b
119/// ENDFOR
120/// dst[MAX:128] := 0
121/// \endcode
122static __inline__ __m128 __DEFAULT_FN_ATTRS128
123_mm_bcstnesh_ps(const void *__A) {
124 return (__m128)__builtin_ia32_vbcstnesh2ps128((const _Float16 *)__A);
125}
126
127/// Convert scalar half-precision (16-bit) floating-point element
128/// stored at memory locations starting at location \a __A to a
129/// single-precision (32-bit) floating-point, broadcast it to packed
130/// single-precision (32-bit) floating-point elements, and store the results in
131/// \a dst.
132///
133/// \headerfile <x86intrin.h>
134///
135/// \code
136/// _mm256_bcstnesh_ps(const void *__A);
137/// \endcode
138///
139/// This intrinsic corresponds to the \c VBCSTNESH2PS instruction.
140///
141/// \param __A
142/// A pointer to a 16-bit memory location. The address of the memory
143/// location does not have to be aligned.
144/// \returns
145/// A 256-bit vector of [8 x float].
146///
147/// \code{.operation}
148/// b := Convert_FP16_To_FP32(MEM[__A+15:__A])
149/// FOR j := 0 to 7
150/// m := j*32
151/// dst[m+31:m] := b
152/// ENDFOR
153/// dst[MAX:256] := 0
154/// \endcode
155static __inline__ __m256 __DEFAULT_FN_ATTRS256
156_mm256_bcstnesh_ps(const void *__A) {
157 return (__m256)__builtin_ia32_vbcstnesh2ps256((const _Float16 *)__A);
158}
159
160/// Convert packed BF16 (16-bit) floating-point even-indexed elements
161/// stored at memory locations starting at location \a __A to packed
162/// single-precision (32-bit) floating-point elements, and store the results in
163/// \a dst.
164///
165/// \headerfile <x86intrin.h>
166///
167/// \code
168/// _mm_cvtneebf16_ps(const __m128bh *__A);
169/// \endcode
170///
171/// This intrinsic corresponds to the \c VCVTNEEBF162PS instruction.
172///
173/// \param __A
174/// A pointer to a 128-bit memory location containing 8 consecutive
175/// BF16 (16-bit) floating-point values.
176/// \returns
177/// A 128-bit vector of [4 x float].
178///
179/// \code{.operation}
180/// FOR j := 0 to 3
181/// k := j*2
182/// i := k*16
183/// m := j*32
184/// dst[m+31:m] := Convert_BF16_To_FP32(MEM[__A+i+15:__A+i])
185/// ENDFOR
186/// dst[MAX:128] := 0
187/// \endcode
188static __inline__ __m128 __DEFAULT_FN_ATTRS128
189_mm_cvtneebf16_ps(const __m128bh *__A) {
190 return (__m128)__builtin_ia32_vcvtneebf162ps128((const __v8bf *)__A);
191}
192
193/// Convert packed BF16 (16-bit) floating-point even-indexed elements
194/// stored at memory locations starting at location \a __A to packed
195/// single-precision (32-bit) floating-point elements, and store the results in
196/// \a dst.
197///
198/// \headerfile <x86intrin.h>
199///
200/// \code
201/// _mm256_cvtneebf16_ps(const __m256bh *__A);
202/// \endcode
203///
204/// This intrinsic corresponds to the \c VCVTNEEBF162PS instruction.
205///
206/// \param __A
207/// A pointer to a 256-bit memory location containing 16 consecutive
208/// BF16 (16-bit) floating-point values.
209/// \returns
210/// A 256-bit vector of [8 x float].
211///
212/// \code{.operation}
213/// FOR j := 0 to 7
214/// k := j*2
215/// i := k*16
216/// m := j*32
217/// dst[m+31:m] := Convert_BF16_To_FP32(MEM[__A+i+15:__A+i])
218/// ENDFOR
219/// dst[MAX:256] := 0
220/// \endcode
221static __inline__ __m256 __DEFAULT_FN_ATTRS256
222_mm256_cvtneebf16_ps(const __m256bh *__A) {
223 return (__m256)__builtin_ia32_vcvtneebf162ps256((const __v16bf *)__A);
224}
225
226/// Convert packed half-precision (16-bit) floating-point even-indexed elements
227/// stored at memory locations starting at location \a __A to packed
228/// single-precision (32-bit) floating-point elements, and store the results in
229/// \a dst.
230///
231/// \headerfile <x86intrin.h>
232///
233/// \code
234/// _mm_cvtneeph_ps(const __m128h *__A);
235/// \endcode
236///
237/// This intrinsic corresponds to the \c VCVTNEEPH2PS instruction.
238///
239/// \param __A
240/// A pointer to a 128-bit memory location containing 8 consecutive
241/// half-precision (16-bit) floating-point values.
242/// \returns
243/// A 128-bit vector of [4 x float].
244///
245/// \code{.operation}
246/// FOR j := 0 to 3
247/// k := j*2
248/// i := k*16
249/// m := j*32
250/// dst[m+31:m] := Convert_FP16_To_FP32(MEM[__A+i+15:__A+i])
251/// ENDFOR
252/// dst[MAX:128] := 0
253/// \endcode
254static __inline__ __m128 __DEFAULT_FN_ATTRS128
255_mm_cvtneeph_ps(const __m128h *__A) {
256 return (__m128)__builtin_ia32_vcvtneeph2ps128((const __v8hf *)__A);
257}
258
259/// Convert packed half-precision (16-bit) floating-point even-indexed elements
260/// stored at memory locations starting at location \a __A to packed
261/// single-precision (32-bit) floating-point elements, and store the results in
262/// \a dst.
263///
264/// \headerfile <x86intrin.h>
265///
266/// \code
267/// _mm256_cvtneeph_ps(const __m256h *__A);
268/// \endcode
269///
270/// This intrinsic corresponds to the \c VCVTNEEPH2PS instruction.
271///
272/// \param __A
273/// A pointer to a 256-bit memory location containing 16 consecutive
274/// half-precision (16-bit) floating-point values.
275/// \returns
276/// A 256-bit vector of [8 x float].
277///
278/// \code{.operation}
279/// FOR j := 0 to 7
280/// k := j*2
281/// i := k*16
282/// m := j*32
283/// dst[m+31:m] := Convert_FP16_To_FP32(MEM[__A+i+15:__A+i])
284/// ENDFOR
285/// dst[MAX:256] := 0
286/// \endcode
287static __inline__ __m256 __DEFAULT_FN_ATTRS256
288_mm256_cvtneeph_ps(const __m256h *__A) {
289 return (__m256)__builtin_ia32_vcvtneeph2ps256((const __v16hf *)__A);
290}
291
292/// Convert packed BF16 (16-bit) floating-point odd-indexed elements
293/// stored at memory locations starting at location \a __A to packed
294/// single-precision (32-bit) floating-point elements, and store the results in
295/// \a dst.
296///
297/// \headerfile <x86intrin.h>
298///
299/// \code
300/// _mm_cvtneobf16_ps(const __m128bh *__A);
301/// \endcode
302///
303/// This intrinsic corresponds to the \c VCVTNEOBF162PS instruction.
304///
305/// \param __A
306/// A pointer to a 128-bit memory location containing 8 consecutive
307/// BF16 (16-bit) floating-point values.
308/// \returns
309/// A 128-bit vector of [4 x float].
310///
311/// \code{.operation}
312/// FOR j := 0 to 3
313/// k := j*2+1
314/// i := k*16
315/// m := j*32
316/// dst[m+31:m] := Convert_BF16_To_FP32(MEM[__A+i+15:__A+i])
317/// ENDFOR
318/// dst[MAX:128] := 0
319/// \endcode
320static __inline__ __m128 __DEFAULT_FN_ATTRS128
321_mm_cvtneobf16_ps(const __m128bh *__A) {
322 return (__m128)__builtin_ia32_vcvtneobf162ps128((const __v8bf *)__A);
323}
324
325/// Convert packed BF16 (16-bit) floating-point odd-indexed elements
326/// stored at memory locations starting at location \a __A to packed
327/// single-precision (32-bit) floating-point elements, and store the results in
328/// \a dst.
329///
330/// \headerfile <x86intrin.h>
331///
332/// \code
333/// _mm256_cvtneobf16_ps(const __m256bh *__A);
334/// \endcode
335///
336/// This intrinsic corresponds to the \c VCVTNEOBF162PS instruction.
337///
338/// \param __A
339/// A pointer to a 256-bit memory location containing 16 consecutive
340/// BF16 (16-bit) floating-point values.
341/// \returns
342/// A 256-bit vector of [8 x float].
343///
344/// \code{.operation}
345/// FOR j := 0 to 7
346/// k := j*2+1
347/// i := k*16
348/// m := j*32
349/// dst[m+31:m] := Convert_BF16_To_FP32(MEM[__A+i+15:__A+i])
350/// ENDFOR
351/// dst[MAX:256] := 0
352/// \endcode
353static __inline__ __m256 __DEFAULT_FN_ATTRS256
354_mm256_cvtneobf16_ps(const __m256bh *__A) {
355 return (__m256)__builtin_ia32_vcvtneobf162ps256((const __v16bf *)__A);
356}
357
358/// Convert packed half-precision (16-bit) floating-point odd-indexed elements
359/// stored at memory locations starting at location \a __A to packed
360/// single-precision (32-bit) floating-point elements, and store the results in
361/// \a dst.
362///
363/// \headerfile <x86intrin.h>
364///
365/// \code
366/// _mm_cvtneoph_ps(const __m128h *__A);
367/// \endcode
368///
369/// This intrinsic corresponds to the \c VCVTNEOPH2PS instruction.
370///
371/// \param __A
372/// A pointer to a 128-bit memory location containing 8 consecutive
373/// half-precision (16-bit) floating-point values.
374/// \returns
375/// A 128-bit vector of [4 x float].
376///
377/// \code{.operation}
378/// FOR j := 0 to 3
379/// k := j*2+1
380/// i := k*16
381/// m := j*32
382/// dst[m+31:m] := Convert_FP16_To_FP32(MEM[__A+i+15:__A+i])
383/// ENDFOR
384/// dst[MAX:128] := 0
385/// \endcode
386static __inline__ __m128 __DEFAULT_FN_ATTRS128
387_mm_cvtneoph_ps(const __m128h *__A) {
388 return (__m128)__builtin_ia32_vcvtneoph2ps128((const __v8hf *)__A);
389}
390
391/// Convert packed half-precision (16-bit) floating-point odd-indexed elements
392/// stored at memory locations starting at location \a __A to packed
393/// single-precision (32-bit) floating-point elements, and store the results in
394/// \a dst.
395///
396/// \headerfile <x86intrin.h>
397///
398/// \code
399/// _mm256_cvtneoph_ps(const __m256h *__A);
400/// \endcode
401///
402/// This intrinsic corresponds to the \c VCVTNEOPH2PS instruction.
403///
404/// \param __A
405/// A pointer to a 256-bit memory location containing 16 consecutive
406/// half-precision (16-bit) floating-point values.
407/// \returns
408/// A 256-bit vector of [8 x float].
409///
410/// \code{.operation}
411/// FOR j := 0 to 7
412/// k := j*2+1
413/// i := k*16
414/// m := j*32
415/// dst[m+31:m] := Convert_FP16_To_FP32(MEM[__A+i+15:__A+i])
416/// ENDFOR
417/// dst[MAX:256] := 0
418/// \endcode
419static __inline__ __m256 __DEFAULT_FN_ATTRS256
420_mm256_cvtneoph_ps(const __m256h *__A) {
421 return (__m256)__builtin_ia32_vcvtneoph2ps256((const __v16hf *)__A);
422}
423
424/// Convert packed single-precision (32-bit) floating-point elements in \a __A
425/// to packed BF16 (16-bit) floating-point elements, and store the results in \a
426/// dst.
427///
428/// \headerfile <x86intrin.h>
429///
430/// \code
431/// _mm_cvtneps_avx_pbh(__m128 __A);
432/// \endcode
433///
434/// This intrinsic corresponds to the \c VCVTNEPS2BF16 instruction.
435///
436/// \param __A
437/// A 128-bit vector of [4 x float].
438/// \returns
439/// A 128-bit vector of [8 x bfloat].
440///
441/// \code{.operation}
442/// FOR j := 0 to 3
443/// dst.word[j] := Convert_FP32_To_BF16(__A.fp32[j])
444/// ENDFOR
445/// dst[MAX:128] := 0
446/// \endcode
447static __inline__ __m128bh __DEFAULT_FN_ATTRS128
448_mm_cvtneps_avx_pbh(__m128 __A) {
449 return (__m128bh)__builtin_ia32_vcvtneps2bf16128((__v4sf)__A);
450}
451
452/// Convert packed single-precision (32-bit) floating-point elements in \a __A
453/// to packed BF16 (16-bit) floating-point elements, and store the results in \a
454/// dst.
455///
456/// \headerfile <x86intrin.h>
457///
458/// \code
459/// _mm256_cvtneps_avx_pbh(__m256 __A);
460/// \endcode
461///
462/// This intrinsic corresponds to the \c VCVTNEPS2BF16 instruction.
463///
464/// \param __A
465/// A 256-bit vector of [8 x float].
466/// \returns
467/// A 128-bit vector of [8 x bfloat].
468///
469/// \code{.operation}
470/// FOR j := 0 to 7
471/// dst.word[j] := Convert_FP32_To_BF16(a.fp32[j])
472/// ENDFOR
473/// dst[MAX:128] := 0
474/// \endcode
475static __inline__ __m128bh __DEFAULT_FN_ATTRS256
476_mm256_cvtneps_avx_pbh(__m256 __A) {
477 return (__m128bh)__builtin_ia32_vcvtneps2bf16256((__v8sf)__A);
478}
479
480#undef __DEFAULT_FN_ATTRS128
481#undef __DEFAULT_FN_ATTRS256
482
483#endif // __AVXNECONVERTINTRIN_H
484#endif // __SSE2__
lib/include/avxvnniint8intrin.h created+471
......@@ -0,0 +1,471 @@
1/*===-------- avxvnniint8intrin.h - AVXVNNIINT8 intrinsics -----------===
2 *
3 * Part of the LLVM Project, under the Apache License v2.0 with LLVM Exceptions.
4 * See https://llvm.org/LICENSE.txt for license information.
5 * SPDX-License-Identifier: Apache-2.0 WITH LLVM-exception
6 *
7 *===-----------------------------------------------------------------------===
8 */
9#ifndef __IMMINTRIN_H
10#error \
11 "Never use <avxvnniint8intrin.h> directly; include <immintrin.h> instead."
12#endif
13
14#ifndef __AVXVNNIINT8INTRIN_H
15#define __AVXVNNIINT8INTRIN_H
16
17/* Define the default attributes for the functions in this file. */
18#define __DEFAULT_FN_ATTRS256 \
19 __attribute__((__always_inline__, __nodebug__, __target__("avxvnniint8"), \
20 __min_vector_width__(256)))
21#define __DEFAULT_FN_ATTRS128 \
22 __attribute__((__always_inline__, __nodebug__, __target__("avxvnniint8"), \
23 __min_vector_width__(128)))
24
25/// Multiply groups of 4 adjacent pairs of signed 8-bit integers in \a __A with
26/// corresponding signed 8-bit integers in \a __B, producing 4 intermediate
27/// signed 16-bit results. Sum these 4 results with the corresponding
28/// 32-bit integer in \a __W, and store the packed 32-bit results in \a dst.
29///
30/// \headerfile <x86intrin.h>
31///
32/// \code
33/// _mm_dpbssd_epi32(__m128i __W, __m128i __A, __m128i __B);
34/// \endcode
35///
36/// This intrinsic corresponds to the \c VPDPBSSD instruction.
37///
38/// \param __A
39/// A 128-bit vector of [16 x char].
40/// \param __B
41/// A 128-bit vector of [16 x char].
42/// \returns
43/// A 128-bit vector of [4 x int].
44///
45/// \code{.operation}
46/// FOR j := 0 to 3
47/// tmp1.word := SignExtend16(__A.byte[4*j]) * SignExtend16(__B.byte[4*j])
48/// tmp2.word := SignExtend16(__A.byte[4*j+1]) * SignExtend16(__B.byte[4*j+1])
49/// tmp3.word := SignExtend16(__A.byte[4*j+2]) * SignExtend16(__B.byte[4*j+2])
50/// tmp4.word := SignExtend16(__A.byte[4*j+3]) * SignExtend16(__B.byte[4*j+3])
51/// dst.dword[j] := __W.dword[j] + tmp1 + tmp2 + tmp3 + tmp4
52/// ENDFOR
53/// dst[MAX:128] := 0
54/// \endcode
55static __inline__ __m128i __DEFAULT_FN_ATTRS128 _mm_dpbssd_epi32(__m128i __W,
56 __m128i __A,
57 __m128i __B) {
58 return (__m128i)__builtin_ia32_vpdpbssd128((__v4si)__W, (__v4si)__A,
59 (__v4si)__B);
60}
61
62/// Multiply groups of 4 adjacent pairs of signed 8-bit integers in \a __A with
63/// corresponding signed 8-bit integers in \a __B, producing 4 intermediate
64/// signed 16-bit results. Sum these 4 results with the corresponding
65/// 32-bit integer in \a __W, and store the packed 32-bit results in \a dst.
66///
67/// \headerfile <x86intrin.h>
68///
69/// \code
70/// _mm256_dpbssd_epi32(__m256i __W, __m256i __A, __m256i __B);
71/// \endcode
72///
73/// This intrinsic corresponds to the \c VPDPBSSD instruction.
74///
75/// \param __A
76/// A 256-bit vector of [32 x char].
77/// \param __B
78/// A 256-bit vector of [32 x char].
79/// \returns
80/// A 256-bit vector of [8 x int].
81///
82/// \code{.operation}
83/// FOR j := 0 to 7
84/// tmp1.word := SignExtend16(__A.byte[4*j]) * SignExtend16(__B.byte[4*j])
85/// tmp2.word := SignExtend16(__A.byte[4*j+1]) * SignExtend16(__B.byte[4*j+1])
86/// tmp3.word := SignExtend16(__A.byte[4*j+2]) * SignExtend16(__B.byte[4*j+2])
87/// tmp4.word := SignExtend16(__A.byte[4*j+3]) * SignExtend16(__B.byte[4*j+3])
88/// dst.dword[j] := __W.dword[j] + tmp1 + tmp2 + tmp3 + tmp4
89/// ENDFOR
90/// dst[MAX:256] := 0
91/// \endcode
92static __inline__ __m256i __DEFAULT_FN_ATTRS256
93_mm256_dpbssd_epi32(__m256i __W, __m256i __A, __m256i __B) {
94 return (__m256i)__builtin_ia32_vpdpbssd256((__v8si)__W, (__v8si)__A,
95 (__v8si)__B);
96}
97
98/// Multiply groups of 4 adjacent pairs of signed 8-bit integers in \a __A with
99/// corresponding signed 8-bit integers in \a __B, producing 4 intermediate
100/// signed 16-bit results. Sum these 4 results with the corresponding
101/// 32-bit integer in \a __W with signed saturation, and store the packed
102/// 32-bit results in \a dst.
103///
104/// \headerfile <x86intrin.h>
105///
106/// \code
107/// _mm_dpbssds_epi32( __m128i __W, __m128i __A, __m128i __B);
108/// \endcode
109///
110/// This intrinsic corresponds to the \c VPDPBSSD instruction.
111///
112/// \param __A
113/// A 128-bit vector of [16 x char].
114/// \param __B
115/// A 128-bit vector of [16 x char].
116/// \returns
117/// A 128-bit vector of [4 x int].
118///
119/// \code{.operation}
120/// FOR j := 0 to 3
121/// tmp1.word := SignExtend16(__A.byte[4*j]) * SignExtend16(__B.byte[4*j])
122/// tmp2.word := SignExtend16(__A.byte[4*j+1]) * SignExtend16(__B.byte[4*j+1])
123/// tmp3.word := SignExtend16(__A.byte[4*j+2]) * SignExtend16(__B.byte[4*j+2])
124/// tmp4.word := SignExtend16(__A.byte[4*j+3]) * SignExtend16(__B.byte[4*j+3])
125/// dst.dword[j] := SIGNED_DWORD_SATURATE(__W.dword[j] + tmp1 + tmp2 + tmp3 + tmp4)
126/// ENDFOR
127/// dst[MAX:128] := 0
128/// \endcode
129static __inline__ __m128i __DEFAULT_FN_ATTRS128 _mm_dpbssds_epi32(__m128i __W,
130 __m128i __A,
131 __m128i __B) {
132 return (__m128i)__builtin_ia32_vpdpbssds128((__v4si)__W, (__v4si)__A,
133 (__v4si)__B);
134}
135
136/// Multiply groups of 4 adjacent pairs of signed 8-bit integers in \a __A with
137/// corresponding signed 8-bit integers in \a __B, producing 4 intermediate
138/// signed 16-bit results. Sum these 4 results with the corresponding
139/// 32-bit integer in \a __W with signed saturation, and store the packed
140/// 32-bit results in \a dst.
141///
142/// \headerfile <x86intrin.h>
143///
144/// \code
145/// _mm256_dpbssds_epi32(__m256i __W, __m256i __A, __m256i __B);
146/// \endcode
147///
148/// This intrinsic corresponds to the \c VPDPBSSD instruction.
149///
150/// \param __A
151/// A 256-bit vector of [32 x char].
152/// \param __B
153/// A 256-bit vector of [32 x char].
154/// \returns
155/// A 256-bit vector of [8 x int].
156///
157/// \code{.operation}
158/// FOR j := 0 to 7
159/// tmp1.word := SignExtend16(__A.byte[4*j]) * SignExtend16(__B.byte[4*j])
160/// tmp2.word := SignExtend16(__A.byte[4*j+1]) * SignExtend16(__B.byte[4*j+1])
161/// tmp3.word := SignExtend16(__A.byte[4*j+2]) * SignExtend16(__B.byte[4*j+2])
162/// tmp4.word := SignExtend16(__A.byte[4*j+3]) * SignExtend16(__B.byte[4*j+3])
163/// dst.dword[j] := SIGNED_DWORD_SATURATE(__W.dword[j] + tmp1 + tmp2 + tmp3 + tmp4)
164/// ENDFOR
165/// dst[MAX:256] := 0
166/// \endcode
167static __inline__ __m256i __DEFAULT_FN_ATTRS256
168_mm256_dpbssds_epi32(__m256i __W, __m256i __A, __m256i __B) {
169 return (__m256i)__builtin_ia32_vpdpbssds256((__v8si)__W, (__v8si)__A,
170 (__v8si)__B);
171}
172
173/// Multiply groups of 4 adjacent pairs of signed 8-bit integers in \a __A with
174/// corresponding unsigned 8-bit integers in \a __B, producing 4 intermediate
175/// signed 16-bit results. Sum these 4 results with the corresponding
176/// 32-bit integer in \a __W, and store the packed 32-bit results in \a dst.
177///
178/// \headerfile <x86intrin.h>
179///
180/// \code
181/// _mm_dpbsud_epi32(__m128i __W, __m128i __A, __m128i __B);
182/// \endcode
183///
184/// This intrinsic corresponds to the \c VPDPBSSD instruction.
185///
186/// \param __A
187/// A 128-bit vector of [16 x char].
188/// \param __B
189/// A 128-bit vector of [16 x unsigned char].
190/// \returns
191/// A 128-bit vector of [4 x int].
192///
193/// \code{.operation}
194/// FOR j := 0 to 3
195/// tmp1.word := Signed(SignExtend16(__A.byte[4*j]) * ZeroExtend16(__B.byte[4*j]))
196/// tmp2.word := Signed(SignExtend16(__A.byte[4*j+1]) * ZeroExtend16(__B.byte[4*j+1]))
197/// tmp3.word := Signed(SignExtend16(__A.byte[4*j+2]) * ZeroExtend16(__B.byte[4*j+2]))
198/// tmp4.word := Signed(SignExtend16(__A.byte[4*j+3]) * ZeroExtend16(__B.byte[4*j+3]))
199/// dst.dword[j] := __W.dword[j] + tmp1 + tmp2 + tmp3 + tmp4
200/// ENDFOR
201/// dst[MAX:128] := 0
202/// \endcode
203static __inline__ __m128i __DEFAULT_FN_ATTRS128 _mm_dpbsud_epi32(__m128i __W,
204 __m128i __A,
205 __m128i __B) {
206 return (__m128i)__builtin_ia32_vpdpbsud128((__v4si)__W, (__v4si)__A,
207 (__v4si)__B);
208}
209
210/// Multiply groups of 4 adjacent pairs of signed 8-bit integers in \a __A with
211/// corresponding unsigned 8-bit integers in \a __B, producing 4 intermediate
212/// signed 16-bit results. Sum these 4 results with the corresponding
213/// 32-bit integer in \a __W, and store the packed 32-bit results in \a dst.
214///
215/// \headerfile <x86intrin.h>
216///
217/// \code
218/// _mm256_dpbsud_epi32(__m256i __W, __m256i __A, __m256i __B);
219/// \endcode
220///
221/// This intrinsic corresponds to the \c VPDPBSSD instruction.
222///
223/// \param __A
224/// A 256-bit vector of [32 x char].
225/// \param __B
226/// A 256-bit vector of [32 x unsigned char].
227/// \returns
228/// A 256-bit vector of [8 x int].
229///
230/// \code{.operation}
231/// FOR j := 0 to 7
232/// tmp1.word := Signed(SignExtend16(__A.byte[4*j]) * ZeroExtend16(__B.byte[4*j]))
233/// tmp2.word := Signed(SignExtend16(__A.byte[4*j+1]) * ZeroExtend16(__B.byte[4*j+1]))
234/// tmp3.word := Signed(SignExtend16(__A.byte[4*j+2]) * ZeroExtend16(__B.byte[4*j+2]))
235/// tmp4.word := Signed(SignExtend16(__A.byte[4*j+3]) * ZeroExtend16(__B.byte[4*j+3]))
236/// dst.dword[j] := __W.dword[j] + tmp1 + tmp2 + tmp3 + tmp4
237/// ENDFOR
238/// dst[MAX:256] := 0
239/// \endcode
240static __inline__ __m256i __DEFAULT_FN_ATTRS256
241_mm256_dpbsud_epi32(__m256i __W, __m256i __A, __m256i __B) {
242 return (__m256i)__builtin_ia32_vpdpbsud256((__v8si)__W, (__v8si)__A,
243 (__v8si)__B);
244}
245
246/// Multiply groups of 4 adjacent pairs of signed 8-bit integers in \a __A with
247/// corresponding unsigned 8-bit integers in \a __B, producing 4 intermediate
248/// signed 16-bit results. Sum these 4 results with the corresponding
249/// 32-bit integer in \a __W with signed saturation, and store the packed
250/// 32-bit results in \a dst.
251///
252/// \headerfile <x86intrin.h>
253///
254/// \code
255/// _mm_dpbsuds_epi32( __m128i __W, __m128i __A, __m128i __B);
256/// \endcode
257///
258/// This intrinsic corresponds to the \c VPDPBSSD instruction.
259///
260/// \param __A
261/// A 128-bit vector of [16 x char].
262/// \param __B
263/// A 128-bit vector of [16 x unsigned char].
264/// \returns
265/// A 128-bit vector of [4 x int].
266///
267/// \code{.operation}
268/// FOR j := 0 to 3
269/// tmp1.word := Signed(SignExtend16(__A.byte[4*j]) * ZeroExtend16(__B.byte[4*j]))
270/// tmp2.word := Signed(SignExtend16(__A.byte[4*j+1]) * ZeroExtend16(__B.byte[4*j+1]))
271/// tmp3.word := Signed(SignExtend16(__A.byte[4*j+2]) * ZeroExtend16(__B.byte[4*j+2]))
272/// tmp4.word := Signed(SignExtend16(__A.byte[4*j+3]) * ZeroExtend16(__B.byte[4*j+3]))
273/// dst.dword[j] := SIGNED_DWORD_SATURATE(__W.dword[j] + tmp1 + tmp2 + tmp3 + tmp4)
274/// ENDFOR
275/// dst[MAX:128] := 0
276/// \endcode
277static __inline__ __m128i __DEFAULT_FN_ATTRS128 _mm_dpbsuds_epi32(__m128i __W,
278 __m128i __A,
279 __m128i __B) {
280 return (__m128i)__builtin_ia32_vpdpbsuds128((__v4si)__W, (__v4si)__A,
281 (__v4si)__B);
282}
283
284/// Multiply groups of 4 adjacent pairs of signed 8-bit integers in \a __A with
285/// corresponding unsigned 8-bit integers in \a __B, producing 4 intermediate
286/// signed 16-bit results. Sum these 4 results with the corresponding
287/// 32-bit integer in \a __W with signed saturation, and store the packed
288/// 32-bit results in \a dst.
289///
290/// \headerfile <x86intrin.h>
291///
292/// \code
293/// _mm256_dpbsuds_epi32(__m256i __W, __m256i __A, __m256i __B);
294/// \endcode
295///
296/// This intrinsic corresponds to the \c VPDPBSSD instruction.
297///
298/// \param __A
299/// A 256-bit vector of [32 x char].
300/// \param __B
301/// A 256-bit vector of [32 x unsigned char].
302/// \returns
303/// A 256-bit vector of [8 x int].
304///
305/// \code{.operation}
306/// FOR j := 0 to 7
307/// tmp1.word := Signed(SignExtend16(__A.byte[4*j]) * ZeroExtend16(__B.byte[4*j]))
308/// tmp2.word := Signed(SignExtend16(__A.byte[4*j+1]) * ZeroExtend16(__B.byte[4*j+1]))
309/// tmp3.word := Signed(SignExtend16(__A.byte[4*j+2]) * ZeroExtend16(__B.byte[4*j+2]))
310/// tmp4.word := Signed(SignExtend16(__A.byte[4*j+3]) * ZeroExtend16(__B.byte[4*j+3]))
311/// dst.dword[j] := SIGNED_DWORD_SATURATE(__W.dword[j] + tmp1 + tmp2 + tmp3 + tmp4)
312/// ENDFOR
313/// dst[MAX:256] := 0
314/// \endcode
315static __inline__ __m256i __DEFAULT_FN_ATTRS256
316_mm256_dpbsuds_epi32(__m256i __W, __m256i __A, __m256i __B) {
317 return (__m256i)__builtin_ia32_vpdpbsuds256((__v8si)__W, (__v8si)__A,
318 (__v8si)__B);
319}
320
321/// Multiply groups of 4 adjacent pairs of unsigned 8-bit integers in \a __A with
322/// corresponding unsigned 8-bit integers in \a __B, producing 4 intermediate
323/// signed 16-bit results. Sum these 4 results with the corresponding
324/// 32-bit integer in \a __W, and store the packed 32-bit results in \a dst.
325///
326/// \headerfile <x86intrin.h>
327///
328/// \code
329/// _mm_dpbuud_epi32(__m128i __W, __m128i __A, __m128i __B);
330/// \endcode
331///
332/// This intrinsic corresponds to the \c VPDPBSSD instruction.
333///
334/// \param __A
335/// A 128-bit vector of [16 x unsigned char].
336/// \param __B
337/// A 128-bit vector of [16 x unsigned char].
338/// \returns
339/// A 128-bit vector of [4 x int].
340///
341/// \code{.operation}
342/// FOR j := 0 to 3
343/// tmp1.word := ZeroExtend16(__A.byte[4*j]) * ZeroExtend16(__B.byte[4*j])
344/// tmp2.word := ZeroExtend16(__A.byte[4*j+1]) * ZeroExtend16(__B.byte[4*j+1])
345/// tmp3.word := ZeroExtend16(__A.byte[4*j+2]) * ZeroExtend16(__B.byte[4*j+2])
346/// tmp4.word := ZeroExtend16(__A.byte[4*j+3]) * ZeroExtend16(__B.byte[4*j+3])
347/// dst.dword[j] := __W.dword[j] + tmp1 + tmp2 + tmp3 + tmp4
348/// ENDFOR
349/// dst[MAX:128] := 0
350/// \endcode
351static __inline__ __m128i __DEFAULT_FN_ATTRS128 _mm_dpbuud_epi32(__m128i __W,
352 __m128i __A,
353 __m128i __B) {
354 return (__m128i)__builtin_ia32_vpdpbuud128((__v4si)__W, (__v4si)__A,
355 (__v4si)__B);
356}
357
358/// Multiply groups of 4 adjacent pairs of unsigned 8-bit integers in \a __A with
359/// corresponding unsigned 8-bit integers in \a __B, producing 4 intermediate
360/// signed 16-bit results. Sum these 4 results with the corresponding
361/// 32-bit integer in \a __W, and store the packed 32-bit results in \a dst.
362///
363/// \headerfile <x86intrin.h>
364///
365/// \code
366/// _mm256_dpbuud_epi32(__m256i __W, __m256i __A, __m256i __B);
367/// \endcode
368///
369/// This intrinsic corresponds to the \c VPDPBSSD instruction.
370///
371/// \param __A
372/// A 256-bit vector of [32 x unsigned char].
373/// \param __B
374/// A 256-bit vector of [32 x unsigned char].
375/// \returns
376/// A 256-bit vector of [8 x int].
377///
378/// \code{.operation}
379/// FOR j := 0 to 7
380/// tmp1.word := ZeroExtend16(__A.byte[4*j]) * ZeroExtend16(__B.byte[4*j])
381/// tmp2.word := ZeroExtend16(__A.byte[4*j+1]) * ZeroExtend16(__B.byte[4*j+1])
382/// tmp3.word := ZeroExtend16(__A.byte[4*j+2]) * ZeroExtend16(__B.byte[4*j+2])
383/// tmp4.word := ZeroExtend16(__A.byte[4*j+3]) * ZeroExtend16(__B.byte[4*j+3])
384/// dst.dword[j] := __W.dword[j] + tmp1 + tmp2 + tmp3 + tmp4
385/// ENDFOR
386/// dst[MAX:256] := 0
387/// \endcode
388static __inline__ __m256i __DEFAULT_FN_ATTRS256
389_mm256_dpbuud_epi32(__m256i __W, __m256i __A, __m256i __B) {
390 return (__m256i)__builtin_ia32_vpdpbuud256((__v8si)__W, (__v8si)__A,
391 (__v8si)__B);
392}
393
394/// Multiply groups of 4 adjacent pairs of unsigned 8-bit integers in \a __A with
395/// corresponding unsigned 8-bit integers in \a __B, producing 4 intermediate
396/// signed 16-bit results. Sum these 4 results with the corresponding
397/// 32-bit integer in \a __W with signed saturation, and store the packed
398/// 32-bit results in \a dst.
399///
400/// \headerfile <x86intrin.h>
401///
402/// \code
403/// _mm_dpbuuds_epi32( __m128i __W, __m128i __A, __m128i __B);
404/// \endcode
405///
406/// This intrinsic corresponds to the \c VPDPBUUDS instruction.
407///
408/// \param __A
409/// A 128-bit vector of [16 x unsigned char].
410/// \param __B
411/// A 128-bit vector of [16 x unsigned char].
412/// \returns
413/// A 128-bit vector of [4 x int].
414///
415/// \code{.operation}
416/// FOR j := 0 to 3
417/// tmp1.word := ZeroExtend16(__A.byte[4*j]) * ZeroExtend16(__B.byte[4*j])
418/// tmp2.word := ZeroExtend16(__A.byte[4*j+1]) * ZeroExtend16(__B.byte[4*j+1])
419/// tmp3.word := ZeroExtend16(__A.byte[4*j+2]) * ZeroExtend16(__B.byte[4*j+2])
420/// tmp4.word := ZeroExtend16(__A.byte[4*j+3]) * ZeroExtend16(__B.byte[4*j+3])
421/// dst.dword[j] := UNSIGNED_DWORD_SATURATE(__W.dword[j] + tmp1 + tmp2 + tmp3 + tmp4)
422/// ENDFOR
423/// dst[MAX:128] := 0
424/// \endcode
425static __inline__ __m128i __DEFAULT_FN_ATTRS128 _mm_dpbuuds_epi32(__m128i __W,
426 __m128i __A,
427 __m128i __B) {
428 return (__m128i)__builtin_ia32_vpdpbuuds128((__v4si)__W, (__v4si)__A,
429 (__v4si)__B);
430}
431
432/// Multiply groups of 4 adjacent pairs of signed 8-bit integers in \a __A with
433/// corresponding unsigned 8-bit integers in \a __B, producing 4 intermediate
434/// signed 16-bit results. Sum these 4 results with the corresponding
435/// 32-bit integer in \a __W with signed saturation, and store the packed
436/// 32-bit results in \a dst.
437///
438/// \headerfile <x86intrin.h>
439///
440/// \code
441/// _mm256_dpbuuds_epi32(__m256i __W, __m256i __A, __m256i __B);
442/// \endcode
443///
444/// This intrinsic corresponds to the \c VPDPBUUDS instruction.
445///
446/// \param __A
447/// A 256-bit vector of [32 x unsigned char].
448/// \param __B
449/// A 256-bit vector of [32 x unsigned char].
450/// \returns
451/// A 256-bit vector of [8 x int].
452///
453/// \code{.operation}
454/// FOR j := 0 to 7
455/// tmp1.word := ZeroExtend16(__A.byte[4*j]) * ZeroExtend16(__B.byte[4*j])
456/// tmp2.word := ZeroExtend16(__A.byte[4*j+1]) * ZeroExtend16(__B.byte[4*j+1])
457/// tmp3.word := ZeroExtend16(__A.byte[4*j+2]) * ZeroExtend16(__B.byte[4*j+2])
458/// tmp4.word := ZeroExtend16(__A.byte[4*j+3]) * ZeroExtend16(__B.byte[4*j+3])
459/// dst.dword[j] := UNSIGNED_DWORD_SATURATE(__W.dword[j] + tmp1 + tmp2 + tmp3 + tmp4)
460/// ENDFOR
461/// dst[MAX:256] := 0
462/// \endcode
463static __inline__ __m256i __DEFAULT_FN_ATTRS256
464_mm256_dpbuuds_epi32(__m256i __W, __m256i __A, __m256i __B) {
465 return (__m256i)__builtin_ia32_vpdpbuuds256((__v8si)__W, (__v8si)__A,
466 (__v8si)__B);
467}
468#undef __DEFAULT_FN_ATTRS128
469#undef __DEFAULT_FN_ATTRS256
470
471#endif // __AVXVNNIINT8INTRIN_H
lib/include/cmpccxaddintrin.h created+70
......@@ -0,0 +1,70 @@
1/*===--------------- cmpccxaddintrin.h - CMPCCXADD intrinsics--------------===
2 *
3 *
4 * Part of the LLVM Project, under the Apache License v2.0 with LLVM Exceptions.
5 * See https://llvm.org/LICENSE.txt for license information.
6 * SPDX-License-Identifier: Apache-2.0 WITH LLVM-exception
7 *
8 *===-----------------------------------------------------------------------===
9 */
10#ifndef __X86GPRINTRIN_H
11#error \
12 "Never use <cmpccxaddintrin.h> directly; include <x86gprintrin.h> instead."
13#endif // __X86GPRINTRIN_H
14
15#ifndef __CMPCCXADDINTRIN_H
16#define __CMPCCXADDINTRIN_H
17#ifdef __x86_64__
18
19typedef enum {
20 _CMPCCX_O, /* Overflow. */
21 _CMPCCX_NO, /* No overflow. */
22 _CMPCCX_B, /* Below. */
23 _CMPCCX_NB, /* Not below. */
24 _CMPCCX_Z, /* Zero. */
25 _CMPCCX_NZ, /* Not zero. */
26 _CMPCCX_BE, /* Below or equal. */
27 _CMPCCX_NBE, /* Neither below nor equal. */
28 _CMPCCX_S, /* Sign. */
29 _CMPCCX_NS, /* No sign. */
30 _CMPCCX_P, /* Parity. */
31 _CMPCCX_NP, /* No parity. */
32 _CMPCCX_L, /* Less. */
33 _CMPCCX_NL, /* Not less. */
34 _CMPCCX_LE, /* Less or equal. */
35 _CMPCCX_NLE, /* Neither less nor equal. */
36} _CMPCCX_ENUM;
37
38/// Compares the value from the memory __A with the value of __B. If the
39/// specified condition __D is met, then add the third operand __C to the
40/// __A and write it into __A, else the value of __A is unchanged. The return
41/// value is the original value of __A.
42///
43/// \headerfile <immintrin.h>
44///
45/// This intrinsic corresponds to the \c CMPCCXADD instructions.
46///
47/// \param __A
48/// __A pointer specifying the memory address.
49///
50/// \param __B
51/// A integer operand.
52///
53/// \param __C
54/// A integer operand.
55///
56/// \param __D
57/// The specified condition.
58///
59/// \returns a integer which is the original value of first operand.
60
61#define _cmpccxadd_epi32(__A, __B, __C, __D) \
62 ((int)(__builtin_ia32_cmpccxadd32((void *)(__A), (int)(__B), (int)(__C), \
63 (int)(__D))))
64
65#define _cmpccxadd_epi64(__A, __B, __C, __D) \
66 ((long long)(__builtin_ia32_cmpccxadd64((void *)(__A), (long long)(__B), \
67 (long long)(__C), (int)(__D))))
68
69#endif // __x86_64__
70#endif // __CMPCCXADDINTRIN_H
lib/include/cpuid.h+11-1
......@@ -200,9 +200,18 @@
200200#define bit_AMXINT8 0x02000000
201201
202202/* Features in %eax for leaf 7 sub-leaf 1 */
203#define bit_RAOINT 0x00000008
203204#define bit_AVXVNNI 0x00000010
204205#define bit_AVX512BF16 0x00000020
206#define bit_CMPCCXADD 0x00000080
207#define bit_AMXFP16 0x00200000
205208#define bit_HRESET 0x00400000
209#define bit_AVXIFMA 0x00800000
210
211/* Features in %edx for leaf 7 sub-leaf 1 */
212#define bit_AVXVNNIINT8 0x00000010
213#define bit_AVXNECONVERT 0x00000020
214#define bit_PREFETCHI 0x00004000
206215
207216/* Features in %eax for leaf 13 sub-leaf 1 */
208217#define bit_XSAVEOPT 0x00000001
......@@ -261,7 +270,8 @@
261270 : "0"(__leaf), "2"(__count))
262271#endif
263272
264static __inline int __get_cpuid_max (unsigned int __leaf, unsigned int *__sig)
273static __inline unsigned int __get_cpuid_max (unsigned int __leaf,
274 unsigned int *__sig)
265275{
266276 unsigned int __eax, __ebx, __ecx, __edx;
267277#if __i386__
lib/include/cuda_wrappers/cmath created+90
......@@ -0,0 +1,90 @@
1/*===---- cmath - CUDA wrapper for <cmath> ---------------------------------===
2 *
3 * Permission is hereby granted, free of charge, to any person obtaining a copy
4 * of this software and associated documentation files (the "Software"), to deal
5 * in the Software without restriction, including without limitation the rights
6 * to use, copy, modify, merge, publish, distribute, sublicense, and/or sell
7 * copies of the Software, and to permit persons to whom the Software is
8 * furnished to do so, subject to the following conditions:
9 *
10 * The above copyright notice and this permission notice shall be included in
11 * all copies or substantial portions of the Software.
12 *
13 * THE SOFTWARE IS PROVIDED "AS IS", WITHOUT WARRANTY OF ANY KIND, EXPRESS OR
14 * IMPLIED, INCLUDING BUT NOT LIMITED TO THE WARRANTIES OF MERCHANTABILITY,
15 * FITNESS FOR A PARTICULAR PURPOSE AND NONINFRINGEMENT. IN NO EVENT SHALL THE
16 * AUTHORS OR COPYRIGHT HOLDERS BE LIABLE FOR ANY CLAIM, DAMAGES OR OTHER
17 * LIABILITY, WHETHER IN AN ACTION OF CONTRACT, TORT OR OTHERWISE, ARISING FROM,
18 * OUT OF OR IN CONNECTION WITH THE SOFTWARE OR THE USE OR OTHER DEALINGS IN
19 * THE SOFTWARE.
20 *
21 *===-----------------------------------------------------------------------===
22 */
23
24#ifndef __CLANG_CUDA_WRAPPERS_CMATH
25#define __CLANG_CUDA_WRAPPERS_CMATH
26
27#include_next <cmath>
28
29#if defined(_LIBCPP_STD_VER)
30
31// libc++ will need long double variants of these functions, but CUDA does not
32// provide them. We'll provide their declarations, which should allow the
33// headers to parse, but would not allow accidental use of them on a GPU.
34
35__attribute__((device)) long double logb(long double);
36__attribute__((device)) long double scalbn(long double, int);
37
38namespace std {
39
40// For __constexpr_fmin/fmax we only need device-side overloads before c++14
41// where they are not constexpr.
42#if _LIBCPP_STD_VER < 14
43
44__attribute__((device))
45inline _LIBCPP_HIDE_FROM_ABI _LIBCPP_CONSTEXPR_SINCE_CXX14 float __constexpr_fmax(float __x, float __y) _NOEXCEPT {
46 return __builtin_fmaxf(__x, __y);
47}
48
49__attribute__((device))
50inline _LIBCPP_HIDE_FROM_ABI _LIBCPP_CONSTEXPR_SINCE_CXX14 double __constexpr_fmax(double __x, double __y) _NOEXCEPT {
51 return __builtin_fmax(__x, __y);
52}
53
54__attribute__((device))
55inline _LIBCPP_HIDE_FROM_ABI _LIBCPP_CONSTEXPR_SINCE_CXX14 long double
56__constexpr_fmax(long double __x, long double __y) _NOEXCEPT {
57 return __builtin_fmaxl(__x, __y);
58}
59
60template <class _Tp, class _Up, __enable_if_t<is_arithmetic<_Tp>::value && is_arithmetic<_Up>::value, int> = 0>
61__attribute__((device))
62_LIBCPP_HIDE_FROM_ABI _LIBCPP_CONSTEXPR_SINCE_CXX14 typename __promote<_Tp, _Up>::type
63__constexpr_fmax(_Tp __x, _Up __y) _NOEXCEPT {
64 using __result_type = typename __promote<_Tp, _Up>::type;
65 return std::__constexpr_fmax(static_cast<__result_type>(__x), static_cast<__result_type>(__y));
66}
67#endif // _LIBCPP_STD_VER < 14
68
69// For logb/scalbn templates we must always provide device overloads because
70// libc++ implementation uses __builtin_XXX which gets translated into a libcall
71// which we can't handle on GPU. We need to forward those to CUDA-provided
72// implementations.
73
74template <class _Tp>
75__attribute__((device))
76_LIBCPP_HIDE_FROM_ABI _LIBCPP_CONSTEXPR_SINCE_CXX14 _Tp __constexpr_logb(_Tp __x) {
77 return ::logb(__x);
78}
79
80template <class _Tp>
81__attribute__((device))
82_LIBCPP_HIDE_FROM_ABI _LIBCPP_CONSTEXPR_SINCE_CXX20 _Tp __constexpr_scalbn(_Tp __x, int __exp) {
83 return ::scalbn(__x, __exp);
84}
85
86} // namespace std//
87
88#endif // _LIBCPP_STD_VER
89
90#endif // include guard
lib/include/emmintrin.h+11-1
......@@ -38,6 +38,16 @@ typedef unsigned char __v16qu __attribute__((__vector_size__(16)));
3838 * appear in the interface though. */
3939typedef signed char __v16qs __attribute__((__vector_size__(16)));
4040
41#ifdef __SSE2__
42/* Both _Float16 and __bf16 require SSE2 being enabled. */
43typedef _Float16 __v8hf __attribute__((__vector_size__(16), __aligned__(16)));
44typedef _Float16 __m128h __attribute__((__vector_size__(16), __aligned__(16)));
45typedef _Float16 __m128h_u __attribute__((__vector_size__(16), __aligned__(1)));
46
47typedef __bf16 __v8bf __attribute__((__vector_size__(16), __aligned__(16)));
48typedef __bf16 __m128bh __attribute__((__vector_size__(16), __aligned__(16)));
49#endif
50
4151/* Define the default attributes for the functions in this file. */
4252#define __DEFAULT_FN_ATTRS \
4353 __attribute__((__always_inline__, __nodebug__, __target__("sse2"), \
......@@ -1809,7 +1819,7 @@ static __inline__ __m128d __DEFAULT_FN_ATTRS _mm_setr_pd(double __w,
18091819/// \returns An initialized 128-bit floating-point vector of [2 x double] with
18101820/// all elements set to zero.
18111821static __inline__ __m128d __DEFAULT_FN_ATTRS _mm_setzero_pd(void) {
1812 return __extension__(__m128d){0, 0};
1822 return __extension__(__m128d){0.0, 0.0};
18131823}
18141824
18151825/// Constructs a 128-bit floating-point vector of [2 x double]. The lower
lib/include/float.h+17-10
......@@ -38,9 +38,10 @@
3838# undef FLT_MANT_DIG
3939# undef DBL_MANT_DIG
4040# undef LDBL_MANT_DIG
41# if __STDC_VERSION__ >= 199901L || !defined(__STRICT_ANSI__) || \
42 __cplusplus >= 201103L || \
43 (__STDC_HOSTED__ && defined(_AIX) && defined(_ALL_SOURCE))
41#if (defined(__STDC_VERSION__) && __STDC_VERSION__ >= 199901L) || \
42 !defined(__STRICT_ANSI__) || \
43 (defined(__cplusplus) && __cplusplus >= 201103L) || \
44 (__STDC_HOSTED__ && defined(_AIX) && defined(_ALL_SOURCE))
4445# undef DECIMAL_DIG
4546# endif
4647# undef FLT_DIG
......@@ -67,9 +68,10 @@
6768# undef FLT_MIN
6869# undef DBL_MIN
6970# undef LDBL_MIN
70# if __STDC_VERSION__ >= 201112L || !defined(__STRICT_ANSI__) || \
71 __cplusplus >= 201703L || \
72 (__STDC_HOSTED__ && defined(_AIX) && defined(_ALL_SOURCE))
71#if (defined(__STDC_VERSION__) && __STDC_VERSION__ >= 201112L) || \
72 !defined(__STRICT_ANSI__) || \
73 (defined(__cplusplus) && __cplusplus >= 201703L) || \
74 (__STDC_HOSTED__ && defined(_AIX) && defined(_ALL_SOURCE))
7375# undef FLT_TRUE_MIN
7476# undef DBL_TRUE_MIN
7577# undef LDBL_TRUE_MIN
......@@ -84,7 +86,10 @@
8486
8587/* Characteristics of floating point types, C99 5.2.4.2.2 */
8688
89#if (defined(__STDC_VERSION__) && __STDC_VERSION__ >= 199901L) || \
90 (defined(__cplusplus) && __cplusplus >= 201103L)
8791#define FLT_EVAL_METHOD __FLT_EVAL_METHOD__
92#endif
8893#define FLT_ROUNDS (__builtin_flt_rounds())
8994#define FLT_RADIX __FLT_RADIX__
9095
......@@ -92,8 +97,9 @@
9297#define DBL_MANT_DIG __DBL_MANT_DIG__
9398#define LDBL_MANT_DIG __LDBL_MANT_DIG__
9499
95#if __STDC_VERSION__ >= 199901L || !defined(__STRICT_ANSI__) || \
96 __cplusplus >= 201103L || \
100#if (defined(__STDC_VERSION__) && __STDC_VERSION__ >= 199901L) || \
101 !defined(__STRICT_ANSI__) || \
102 (defined(__cplusplus) && __cplusplus >= 201103L) || \
97103 (__STDC_HOSTED__ && defined(_AIX) && defined(_ALL_SOURCE))
98104# define DECIMAL_DIG __DECIMAL_DIG__
99105#endif
......@@ -130,8 +136,9 @@
130136#define DBL_MIN __DBL_MIN__
131137#define LDBL_MIN __LDBL_MIN__
132138
133#if __STDC_VERSION__ >= 201112L || !defined(__STRICT_ANSI__) || \
134 __cplusplus >= 201703L || \
139#if (defined(__STDC_VERSION__) && __STDC_VERSION__ >= 201112L) || \
140 !defined(__STRICT_ANSI__) || \
141 (defined(__cplusplus) && __cplusplus >= 201703L) || \
135142 (__STDC_HOSTED__ && defined(_AIX) && defined(_ALL_SOURCE))
136143# define FLT_TRUE_MIN __FLT_DENORM_MIN__
137144# define DBL_TRUE_MIN __DBL_DENORM_MIN__
lib/include/gfniintrin.h+7-5
......@@ -20,10 +20,12 @@
2020/* Default attributes for YMM unmasked form. */
2121#define __DEFAULT_FN_ATTRS_Y __attribute__((__always_inline__, __nodebug__, __target__("avx,gfni"), __min_vector_width__(256)))
2222
23/* Default attributes for ZMM forms. */
24#define __DEFAULT_FN_ATTRS_Z __attribute__((__always_inline__, __nodebug__, __target__("avx512bw,gfni"), __min_vector_width__(512)))
23/* Default attributes for ZMM unmasked forms. */
24#define __DEFAULT_FN_ATTRS_Z __attribute__((__always_inline__, __nodebug__, __target__("avx512f,gfni"), __min_vector_width__(512)))
25/* Default attributes for ZMM masked forms. */
26#define __DEFAULT_FN_ATTRS_Z_MASK __attribute__((__always_inline__, __nodebug__, __target__("avx512bw,gfni"), __min_vector_width__(512)))
2527
26/* Default attributes for VLX forms. */
28/* Default attributes for VLX masked forms. */
2729#define __DEFAULT_FN_ATTRS_VL128 __attribute__((__always_inline__, __nodebug__, __target__("avx512bw,avx512vl,gfni"), __min_vector_width__(128)))
2830#define __DEFAULT_FN_ATTRS_VL256 __attribute__((__always_inline__, __nodebug__, __target__("avx512bw,avx512vl,gfni"), __min_vector_width__(256)))
2931
......@@ -99,7 +101,7 @@ _mm512_gf2p8mul_epi8(__m512i __A, __m512i __B)
99101 (__v64qi) __B);
100102}
101103
102static __inline__ __m512i __DEFAULT_FN_ATTRS_Z
104static __inline__ __m512i __DEFAULT_FN_ATTRS_Z_MASK
103105_mm512_mask_gf2p8mul_epi8(__m512i __S, __mmask64 __U, __m512i __A, __m512i __B)
104106{
105107 return (__m512i) __builtin_ia32_selectb_512(__U,
......@@ -107,7 +109,7 @@ _mm512_mask_gf2p8mul_epi8(__m512i __S, __mmask64 __U, __m512i __A, __m512i __B)
107109 (__v64qi) __S);
108110}
109111
110static __inline__ __m512i __DEFAULT_FN_ATTRS_Z
112static __inline__ __m512i __DEFAULT_FN_ATTRS_Z_MASK
111113_mm512_maskz_gf2p8mul_epi8(__mmask64 __U, __m512i __A, __m512i __B)
112114{
113115 return _mm512_mask_gf2p8mul_epi8((__m512i)_mm512_setzero_si512(),
lib/include/hlsl.h deleted-15
......@@ -1,15 +0,0 @@
1//===----- hlsl.h - HLSL definitions --------------------------------------===//
2//
3// Part of the LLVM Project, under the Apache License v2.0 with LLVM Exceptions.
4// See https://llvm.org/LICENSE.txt for license information.
5// SPDX-License-Identifier: Apache-2.0 WITH LLVM-exception
6//
7//===----------------------------------------------------------------------===//
8
9#ifndef _HLSL_H_
10#define _HLSL_H_
11
12#include "hlsl/hlsl_basic_types.h"
13#include "hlsl/hlsl_intrinsics.h"
14
15#endif //_HLSL_H_
lib/include/hlsl_basic_types.h deleted-64
......@@ -1,64 +0,0 @@
1//===----- hlsl_basic_types.h - HLSL definitions for basic types ----------===//
2//
3// Part of the LLVM Project, under the Apache License v2.0 with LLVM Exceptions.
4// See https://llvm.org/LICENSE.txt for license information.
5// SPDX-License-Identifier: Apache-2.0 WITH LLVM-exception
6//
7//===----------------------------------------------------------------------===//
8
9#ifndef _HLSL_HLSL_BASIC_TYPES_H_
10#define _HLSL_HLSL_BASIC_TYPES_H_
11
12// built-in scalar data types:
13
14#ifdef __HLSL_ENABLE_16_BIT
15// 16-bit integer.
16typedef unsigned short uint16_t;
17typedef short int16_t;
18#endif
19
20// unsigned 32-bit integer.
21typedef unsigned int uint;
22
23// 64-bit integer.
24typedef unsigned long uint64_t;
25typedef long int64_t;
26
27// built-in vector data types:
28
29#ifdef __HLSL_ENABLE_16_BIT
30typedef vector<int16_t, 2> int16_t2;
31typedef vector<int16_t, 3> int16_t3;
32typedef vector<int16_t, 4> int16_t4;
33typedef vector<uint16_t, 2> uint16_t2;
34typedef vector<uint16_t, 3> uint16_t3;
35typedef vector<uint16_t, 4> uint16_t4;
36#endif
37
38typedef vector<int, 2> int2;
39typedef vector<int, 3> int3;
40typedef vector<int, 4> int4;
41typedef vector<uint, 2> uint2;
42typedef vector<uint, 3> uint3;
43typedef vector<uint, 4> uint4;
44typedef vector<int64_t, 2> int64_t2;
45typedef vector<int64_t, 3> int64_t3;
46typedef vector<int64_t, 4> int64_t4;
47typedef vector<uint64_t, 2> uint64_t2;
48typedef vector<uint64_t, 3> uint64_t3;
49typedef vector<uint64_t, 4> uint64_t4;
50
51#ifdef __HLSL_ENABLE_16_BIT
52typedef vector<half, 2> half2;
53typedef vector<half, 3> half3;
54typedef vector<half, 4> half4;
55#endif
56
57typedef vector<float, 2> float2;
58typedef vector<float, 3> float3;
59typedef vector<float, 4> float4;
60typedef vector<double, 2> double2;
61typedef vector<double, 3> double3;
62typedef vector<double, 4> double4;
63
64#endif //_HLSL_HLSL_BASIC_TYPES_H_
lib/include/hlsl_intrinsics.h deleted-15
......@@ -1,15 +0,0 @@
1//===----- hlsl_intrinsics.h - HLSL definitions for intrinsics ----------===//
2//
3// Part of the LLVM Project, under the Apache License v2.0 with LLVM Exceptions.
4// See https://llvm.org/LICENSE.txt for license information.
5// SPDX-License-Identifier: Apache-2.0 WITH LLVM-exception
6//
7//===----------------------------------------------------------------------===//
8
9#ifndef _HLSL_HLSL_INTRINSICS_H_
10#define _HLSL_HLSL_INTRINSICS_H_
11
12__attribute__((clang_builtin_alias(__builtin_hlsl_wave_active_count_bits))) uint
13WaveActiveCountBits(bool bBit);
14
15#endif //_HLSL_HLSL_INTRINSICS_H_
lib/include/immintrin.h+40-8
......@@ -189,6 +189,11 @@
189189#include <avx512ifmavlintrin.h>
190190#endif
191191
192#if !(defined(_MSC_VER) || defined(__SCE__)) || __has_feature(modules) || \
193 defined(__AVXIFMA__)
194#include <avxifmaintrin.h>
195#endif
196
192197#if !(defined(_MSC_VER) || defined(__SCE__)) || __has_feature(modules) || \
193198 defined(__AVX512VBMI__)
194199#include <avx512vbmiintrin.h>
......@@ -214,17 +219,13 @@
214219#include <avx512pfintrin.h>
215220#endif
216221
217/*
218 * FIXME: _Float16 type is legal only when HW support float16 operation.
219 * We use __AVX512FP16__ to identify if float16 is supported or not, so
220 * when float16 is not supported, the related header is not included.
221 *
222 */
223#if defined(__AVX512FP16__)
222#if !(defined(_MSC_VER) || defined(__SCE__)) || __has_feature(modules) || \
223 defined(__AVX512FP16__)
224224#include <avx512fp16intrin.h>
225225#endif
226226
227#if defined(__AVX512FP16__) && defined(__AVX512VL__)
227#if !(defined(_MSC_VER) || defined(__SCE__)) || __has_feature(modules) || \
228 (defined(__AVX512VL__) && defined(__AVX512FP16__))
228229#include <avx512vlfp16intrin.h>
229230#endif
230231
......@@ -258,6 +259,16 @@
258259#include <gfniintrin.h>
259260#endif
260261
262#if !(defined(_MSC_VER) || defined(__SCE__)) || __has_feature(modules) || \
263 defined(__AVXVNNIINT8__)
264#include <avxvnniint8intrin.h>
265#endif
266
267#if !(defined(_MSC_VER) || defined(__SCE__)) || __has_feature(modules) || \
268 defined(__AVXNECONVERT__)
269#include <avxneconvertintrin.h>
270#endif
271
261272#if !(defined(_MSC_VER) || defined(__SCE__)) || __has_feature(modules) || \
262273 defined(__RDPID__)
263274/// Returns the value of the IA32_TSC_AUX MSR (0xc0000103).
......@@ -291,6 +302,23 @@ _rdrand64_step(unsigned long long *__p)
291302{
292303 return (int)__builtin_ia32_rdrand64_step(__p);
293304}
305#else
306// We need to emulate the functionality of 64-bit rdrand with 2 32-bit
307// rdrand instructions.
308static __inline__ int __attribute__((__always_inline__, __nodebug__, __target__("rdrnd")))
309_rdrand64_step(unsigned long long *__p)
310{
311 unsigned int __lo, __hi;
312 unsigned int __res_lo = __builtin_ia32_rdrand32_step(&__lo);
313 unsigned int __res_hi = __builtin_ia32_rdrand32_step(&__hi);
314 if (__res_lo && __res_hi) {
315 *__p = ((unsigned long long)__hi << 32) | (unsigned long long)__lo;
316 return 1;
317 } else {
318 *__p = 0;
319 return 0;
320 }
321}
294322#endif
295323#endif /* __RDRND__ */
296324
......@@ -495,6 +523,10 @@ _storebe_i64(void * __P, long long __D) {
495523 defined(__INVPCID__)
496524#include <invpcidintrin.h>
497525#endif
526#if !(defined(_MSC_VER) || defined(__SCE__)) || __has_feature(modules) || \
527 defined(__AMXFP16__)
528#include <amxfp16intrin.h>
529#endif
498530
499531#if !(defined(_MSC_VER) || defined(__SCE__)) || __has_feature(modules) || \
500532 defined(__KL__) || defined(__WIDEKL__)
lib/include/larchintrin.h created+234
......@@ -0,0 +1,234 @@
1/*===------------ larchintrin.h - LoongArch intrinsics ---------------------===
2 *
3 * Part of the LLVM Project, under the Apache License v2.0 with LLVM Exceptions.
4 * See https://llvm.org/LICENSE.txt for license information.
5 * SPDX-License-Identifier: Apache-2.0 WITH LLVM-exception
6 *
7 *===-----------------------------------------------------------------------===
8 */
9
10#ifndef _LOONGARCH_BASE_INTRIN_H
11#define _LOONGARCH_BASE_INTRIN_H
12
13#ifdef __cplusplus
14extern "C" {
15#endif
16
17typedef struct rdtime {
18 unsigned int value;
19 unsigned int timeid;
20} __rdtime_t;
21
22#if __loongarch_grlen == 64
23typedef struct drdtime {
24 unsigned long dvalue;
25 unsigned long dtimeid;
26} __drdtime_t;
27
28extern __inline __drdtime_t
29 __attribute__((__gnu_inline__, __always_inline__, __artificial__))
30 __rdtime_d(void) {
31 __drdtime_t __drdtime;
32 __asm__ volatile(
33 "rdtime.d %[val], %[tid]\n\t"
34 : [val] "=&r"(__drdtime.dvalue), [tid] "=&r"(__drdtime.dtimeid));
35 return __drdtime;
36}
37#endif
38
39extern __inline __rdtime_t
40 __attribute__((__gnu_inline__, __always_inline__, __artificial__))
41 __rdtimeh_w(void) {
42 __rdtime_t __rdtime;
43 __asm__ volatile("rdtimeh.w %[val], %[tid]\n\t"
44 : [val] "=&r"(__rdtime.value), [tid] "=&r"(__rdtime.timeid));
45 return __rdtime;
46}
47
48extern __inline __rdtime_t
49 __attribute__((__gnu_inline__, __always_inline__, __artificial__))
50 __rdtimel_w(void) {
51 __rdtime_t __rdtime;
52 __asm__ volatile("rdtimel.w %[val], %[tid]\n\t"
53 : [val] "=&r"(__rdtime.value), [tid] "=&r"(__rdtime.timeid));
54 return __rdtime;
55}
56
57#if __loongarch_grlen == 64
58extern __inline int
59 __attribute__((__gnu_inline__, __always_inline__, __artificial__))
60 __crc_w_b_w(char _1, int _2) {
61 return (int)__builtin_loongarch_crc_w_b_w((char)_1, (int)_2);
62}
63
64extern __inline int
65 __attribute__((__gnu_inline__, __always_inline__, __artificial__))
66 __crc_w_h_w(short _1, int _2) {
67 return (int)__builtin_loongarch_crc_w_h_w((short)_1, (int)_2);
68}
69
70extern __inline int
71 __attribute__((__gnu_inline__, __always_inline__, __artificial__))
72 __crc_w_w_w(int _1, int _2) {
73 return (int)__builtin_loongarch_crc_w_w_w((int)_1, (int)_2);
74}
75
76extern __inline int
77 __attribute__((__gnu_inline__, __always_inline__, __artificial__))
78 __crc_w_d_w(long int _1, int _2) {
79 return (int)__builtin_loongarch_crc_w_d_w((long int)_1, (int)_2);
80}
81
82extern __inline int
83 __attribute__((__gnu_inline__, __always_inline__, __artificial__))
84 __crcc_w_b_w(char _1, int _2) {
85 return (int)__builtin_loongarch_crcc_w_b_w((char)_1, (int)_2);
86}
87
88extern __inline int
89 __attribute__((__gnu_inline__, __always_inline__, __artificial__))
90 __crcc_w_h_w(short _1, int _2) {
91 return (int)__builtin_loongarch_crcc_w_h_w((short)_1, (int)_2);
92}
93
94extern __inline int
95 __attribute__((__gnu_inline__, __always_inline__, __artificial__))
96 __crcc_w_w_w(int _1, int _2) {
97 return (int)__builtin_loongarch_crcc_w_w_w((int)_1, (int)_2);
98}
99
100extern __inline int
101 __attribute__((__gnu_inline__, __always_inline__, __artificial__))
102 __crcc_w_d_w(long int _1, int _2) {
103 return (int)__builtin_loongarch_crcc_w_d_w((long int)_1, (int)_2);
104}
105#endif
106
107#define __break(/*ui15*/ _1) __builtin_loongarch_break((_1))
108
109#if __loongarch_grlen == 32
110#define __cacop_w(/*uimm5*/ _1, /*unsigned int*/ _2, /*simm12*/ _3) \
111 ((void)__builtin_loongarch_cacop_w((_1), (unsigned int)(_2), (_3)))
112#endif
113
114#if __loongarch_grlen == 64
115#define __cacop_d(/*uimm5*/ _1, /*unsigned long int*/ _2, /*simm12*/ _3) \
116 ((void)__builtin_loongarch_cacop_d((_1), (unsigned long int)(_2), (_3)))
117#endif
118
119#define __dbar(/*ui15*/ _1) __builtin_loongarch_dbar((_1))
120
121#define __ibar(/*ui15*/ _1) __builtin_loongarch_ibar((_1))
122
123#define __movfcsr2gr(/*ui5*/ _1) __builtin_loongarch_movfcsr2gr((_1));
124
125#define __movgr2fcsr(/*ui5*/ _1, _2) \
126 __builtin_loongarch_movgr2fcsr((_1), (unsigned int)_2);
127
128#define __syscall(/*ui15*/ _1) __builtin_loongarch_syscall((_1))
129
130#define __csrrd_w(/*ui14*/ _1) ((unsigned int)__builtin_loongarch_csrrd_w((_1)))
131
132#define __csrwr_w(/*unsigned int*/ _1, /*ui14*/ _2) \
133 ((unsigned int)__builtin_loongarch_csrwr_w((unsigned int)(_1), (_2)))
134
135#define __csrxchg_w(/*unsigned int*/ _1, /*unsigned int*/ _2, /*ui14*/ _3) \
136 ((unsigned int)__builtin_loongarch_csrxchg_w((unsigned int)(_1), \
137 (unsigned int)(_2), (_3)))
138
139#if __loongarch_grlen == 64
140#define __csrrd_d(/*ui14*/ _1) \
141 ((unsigned long int)__builtin_loongarch_csrrd_d((_1)))
142
143#define __csrwr_d(/*unsigned long int*/ _1, /*ui14*/ _2) \
144 ((unsigned long int)__builtin_loongarch_csrwr_d((unsigned long int)(_1), \
145 (_2)))
146
147#define __csrxchg_d(/*unsigned long int*/ _1, /*unsigned long int*/ _2, \
148 /*ui14*/ _3) \
149 ((unsigned long int)__builtin_loongarch_csrxchg_d( \
150 (unsigned long int)(_1), (unsigned long int)(_2), (_3)))
151#endif
152
153extern __inline unsigned char
154 __attribute__((__gnu_inline__, __always_inline__, __artificial__))
155 __iocsrrd_b(unsigned int _1) {
156 return (unsigned char)__builtin_loongarch_iocsrrd_b((unsigned int)_1);
157}
158
159extern __inline unsigned char
160 __attribute__((__gnu_inline__, __always_inline__, __artificial__))
161 __iocsrrd_h(unsigned int _1) {
162 return (unsigned short)__builtin_loongarch_iocsrrd_h((unsigned int)_1);
163}
164
165extern __inline unsigned int
166 __attribute__((__gnu_inline__, __always_inline__, __artificial__))
167 __iocsrrd_w(unsigned int _1) {
168 return (unsigned int)__builtin_loongarch_iocsrrd_w((unsigned int)_1);
169}
170
171#if __loongarch_grlen == 64
172extern __inline unsigned long int
173 __attribute__((__gnu_inline__, __always_inline__, __artificial__))
174 __iocsrrd_d(unsigned int _1) {
175 return (unsigned long int)__builtin_loongarch_iocsrrd_d((unsigned int)_1);
176}
177#endif
178
179extern __inline void
180 __attribute__((__gnu_inline__, __always_inline__, __artificial__))
181 __iocsrwr_b(unsigned char _1, unsigned int _2) {
182 __builtin_loongarch_iocsrwr_b((unsigned char)_1, (unsigned int)_2);
183}
184
185extern __inline void
186 __attribute__((__gnu_inline__, __always_inline__, __artificial__))
187 __iocsrwr_h(unsigned short _1, unsigned int _2) {
188 __builtin_loongarch_iocsrwr_h((unsigned short)_1, (unsigned int)_2);
189}
190
191extern __inline void
192 __attribute__((__gnu_inline__, __always_inline__, __artificial__))
193 __iocsrwr_w(unsigned int _1, unsigned int _2) {
194 __builtin_loongarch_iocsrwr_w((unsigned int)_1, (unsigned int)_2);
195}
196
197extern __inline unsigned int
198 __attribute__((__gnu_inline__, __always_inline__, __artificial__))
199 __cpucfg(unsigned int _1) {
200 return (unsigned int)__builtin_loongarch_cpucfg((unsigned int)_1);
201}
202
203#if __loongarch_grlen == 64
204extern __inline void
205 __attribute__((__gnu_inline__, __always_inline__, __artificial__))
206 __iocsrwr_d(unsigned long int _1, unsigned int _2) {
207 __builtin_loongarch_iocsrwr_d((unsigned long int)_1, (unsigned int)_2);
208}
209
210extern __inline void
211 __attribute__((__gnu_inline__, __always_inline__, __artificial__))
212 __asrtgt_d(long int _1, long int _2) {
213 __builtin_loongarch_asrtgt_d((long int)_1, (long int)_2);
214}
215
216extern __inline void
217 __attribute__((__gnu_inline__, __always_inline__, __artificial__))
218 __asrtle_d(long int _1, long int _2) {
219 __builtin_loongarch_asrtle_d((long int)_1, (long int)_2);
220}
221#endif
222
223#if __loongarch_grlen == 64
224#define __lddir_d(/*long int*/ _1, /*ui5*/ _2) \
225 ((long int)__builtin_loongarch_lddir_d((long int)(_1), (_2)))
226
227#define __ldpte_d(/*long int*/ _1, /*ui5*/ _2) \
228 ((void)__builtin_loongarch_ldpte_d((long int)(_1), (_2)))
229#endif
230
231#ifdef __cplusplus
232}
233#endif
234#endif /* _LOONGARCH_BASE_INTRIN_H */
lib/include/limits.h+3-2
......@@ -65,7 +65,7 @@
6565/* C2x 5.2.4.2.1 */
6666/* FIXME: This is using the placeholder dates Clang produces for these macros
6767 in C2x mode; switch to the correct values once they've been published. */
68#if __STDC_VERSION__ >= 202000L
68#if defined(__STDC_VERSION__) && __STDC_VERSION__ >= 202000L
6969#define BOOL_WIDTH __BOOL_WIDTH__
7070#define CHAR_WIDTH CHAR_BIT
7171#define SCHAR_WIDTH CHAR_BIT
......@@ -93,7 +93,8 @@
9393/* C99 5.2.4.2.1: Added long long.
9494 C++11 18.3.3.2: same contents as the Standard C Library header <limits.h>.
9595 */
96#if __STDC_VERSION__ >= 199901L || __cplusplus >= 201103L
96#if (defined(__STDC_VERSION__) && __STDC_VERSION__ >= 199901L) || \
97 (defined(__cplusplus) && __cplusplus >= 201103L)
9798
9899#undef LLONG_MIN
99100#undef LLONG_MAX
lib/include/opencl-c-base.h+19
......@@ -74,6 +74,25 @@
7474#define __opencl_c_atomic_scope_all_devices 1
7575#define __opencl_c_read_write_images 1
7676#endif // defined(__SPIR__)
77
78// Undefine any feature macros that have been explicitly disabled using
79// an __undef_<feature> macro.
80#ifdef __undef___opencl_c_work_group_collective_functions
81#undef __opencl_c_work_group_collective_functions
82#endif
83#ifdef __undef___opencl_c_atomic_order_seq_cst
84#undef __opencl_c_atomic_order_seq_cst
85#endif
86#ifdef __undef___opencl_c_atomic_scope_device
87#undef __opencl_c_atomic_scope_device
88#endif
89#ifdef __undef___opencl_c_atomic_scope_all_devices
90#undef __opencl_c_atomic_scope_all_devices
91#endif
92#ifdef __undef___opencl_c_read_write_images
93#undef __opencl_c_read_write_images
94#endif
95
7796#endif // (__OPENCL_CPP_VERSION__ == 202100 || __OPENCL_C_VERSION__ == 300)
7897
7998#if !defined(__opencl_c_generic_address_space)
lib/include/opencl-c.h+175-145
......@@ -12396,11 +12396,11 @@ void __ovld vstorea_half16_rtn(double16, size_t, __private half *);
1239612396 * image objects and then want to read the updated data.
1239712397 */
1239812398
12399void __ovld __conv barrier(cl_mem_fence_flags flags);
12399void __ovld __conv barrier(cl_mem_fence_flags);
1240012400
1240112401#if defined(__OPENCL_CPP_VERSION__) || (__OPENCL_C_VERSION__ >= CL_VERSION_2_0)
12402void __ovld __conv work_group_barrier(cl_mem_fence_flags flags, memory_scope);
12403void __ovld __conv work_group_barrier(cl_mem_fence_flags flags);
12402void __ovld __conv work_group_barrier(cl_mem_fence_flags, memory_scope);
12403void __ovld __conv work_group_barrier(cl_mem_fence_flags);
1240412404#endif //defined(__OPENCL_CPP_VERSION__) || (__OPENCL_C_VERSION__ >= CL_VERSION_2_0)
1240512405
1240612406// OpenCL v1.1 s6.11.9, v1.2 s6.12.9 - Explicit Memory Fence Functions
......@@ -12418,7 +12418,7 @@ void __ovld __conv work_group_barrier(cl_mem_fence_flags flags);
1241812418 * CLK_LOCAL_MEM_FENCE
1241912419 * CLK_GLOBAL_MEM_FENCE.
1242012420 */
12421void __ovld mem_fence(cl_mem_fence_flags flags);
12421void __ovld mem_fence(cl_mem_fence_flags);
1242212422
1242312423/**
1242412424 * Read memory barrier that orders only
......@@ -12430,7 +12430,7 @@ void __ovld mem_fence(cl_mem_fence_flags flags);
1243012430 * CLK_LOCAL_MEM_FENCE
1243112431 * CLK_GLOBAL_MEM_FENCE.
1243212432 */
12433void __ovld read_mem_fence(cl_mem_fence_flags flags);
12433void __ovld read_mem_fence(cl_mem_fence_flags);
1243412434
1243512435/**
1243612436 * Write memory barrier that orders only
......@@ -12442,7 +12442,7 @@ void __ovld read_mem_fence(cl_mem_fence_flags flags);
1244212442 * CLK_LOCAL_MEM_FENCE
1244312443 * CLK_GLOBAL_MEM_FENCE.
1244412444 */
12445void __ovld write_mem_fence(cl_mem_fence_flags flags);
12445void __ovld write_mem_fence(cl_mem_fence_flags);
1244612446
1244712447// OpenCL v2.0 s6.13.9 - Address Space Qualifier Functions
1244812448
......@@ -12891,29 +12891,29 @@ void __ovld prefetch(const __global half16 *, size_t);
1289112891 * (old + val) and store result at location
1289212892 * pointed by p. The function returns old.
1289312893 */
12894int __ovld atomic_add(volatile __global int *p, int val);
12895uint __ovld atomic_add(volatile __global uint *p, uint val);
12896int __ovld atomic_add(volatile __local int *p, int val);
12897uint __ovld atomic_add(volatile __local uint *p, uint val);
12894int __ovld atomic_add(volatile __global int *, int);
12895uint __ovld atomic_add(volatile __global uint *, uint);
12896int __ovld atomic_add(volatile __local int *, int);
12897uint __ovld atomic_add(volatile __local uint *, uint);
1289812898#ifdef __OPENCL_CPP_VERSION__
12899int __ovld atomic_add(volatile int *p, int val);
12900uint __ovld atomic_add(volatile uint *p, uint val);
12899int __ovld atomic_add(volatile int *, int);
12900uint __ovld atomic_add(volatile uint *, uint);
1290112901#endif
1290212902
1290312903#if defined(cl_khr_global_int32_base_atomics)
12904int __ovld atom_add(volatile __global int *p, int val);
12905uint __ovld atom_add(volatile __global uint *p, uint val);
12904int __ovld atom_add(volatile __global int *, int);
12905uint __ovld atom_add(volatile __global uint *, uint);
1290612906#endif
1290712907#if defined(cl_khr_local_int32_base_atomics)
12908int __ovld atom_add(volatile __local int *p, int val);
12909uint __ovld atom_add(volatile __local uint *p, uint val);
12908int __ovld atom_add(volatile __local int *, int);
12909uint __ovld atom_add(volatile __local uint *, uint);
1291012910#endif
1291112911
1291212912#if defined(cl_khr_int64_base_atomics)
12913long __ovld atom_add(volatile __global long *p, long val);
12914ulong __ovld atom_add(volatile __global ulong *p, ulong val);
12915long __ovld atom_add(volatile __local long *p, long val);
12916ulong __ovld atom_add(volatile __local ulong *p, ulong val);
12913long __ovld atom_add(volatile __global long *, long);
12914ulong __ovld atom_add(volatile __global ulong *, ulong);
12915long __ovld atom_add(volatile __local long *, long);
12916ulong __ovld atom_add(volatile __local ulong *, ulong);
1291712917#endif
1291812918
1291912919/**
......@@ -12921,29 +12921,29 @@ ulong __ovld atom_add(volatile __local ulong *p, ulong val);
1292112921 * Compute (old - val) and store result at location pointed by p. The function
1292212922 * returns old.
1292312923 */
12924int __ovld atomic_sub(volatile __global int *p, int val);
12925uint __ovld atomic_sub(volatile __global uint *p, uint val);
12926int __ovld atomic_sub(volatile __local int *p, int val);
12927uint __ovld atomic_sub(volatile __local uint *p, uint val);
12924int __ovld atomic_sub(volatile __global int *, int);
12925uint __ovld atomic_sub(volatile __global uint *, uint);
12926int __ovld atomic_sub(volatile __local int *, int);
12927uint __ovld atomic_sub(volatile __local uint *, uint);
1292812928#ifdef __OPENCL_CPP_VERSION__
12929int __ovld atomic_sub(volatile int *p, int val);
12930uint __ovld atomic_sub(volatile uint *p, uint val);
12929int __ovld atomic_sub(volatile int *, int);
12930uint __ovld atomic_sub(volatile uint *, uint);
1293112931#endif
1293212932
1293312933#if defined(cl_khr_global_int32_base_atomics)
12934int __ovld atom_sub(volatile __global int *p, int val);
12935uint __ovld atom_sub(volatile __global uint *p, uint val);
12934int __ovld atom_sub(volatile __global int *, int);
12935uint __ovld atom_sub(volatile __global uint *, uint);
1293612936#endif
1293712937#if defined(cl_khr_local_int32_base_atomics)
12938int __ovld atom_sub(volatile __local int *p, int val);
12939uint __ovld atom_sub(volatile __local uint *p, uint val);
12938int __ovld atom_sub(volatile __local int *, int);
12939uint __ovld atom_sub(volatile __local uint *, uint);
1294012940#endif
1294112941
1294212942#if defined(cl_khr_int64_base_atomics)
12943long __ovld atom_sub(volatile __global long *p, long val);
12944ulong __ovld atom_sub(volatile __global ulong *p, ulong val);
12945long __ovld atom_sub(volatile __local long *p, long val);
12946ulong __ovld atom_sub(volatile __local ulong *p, ulong val);
12943long __ovld atom_sub(volatile __global long *, long);
12944ulong __ovld atom_sub(volatile __global ulong *, ulong);
12945long __ovld atom_sub(volatile __local long *, long);
12946ulong __ovld atom_sub(volatile __local ulong *, ulong);
1294712947#endif
1294812948
1294912949/**
......@@ -12951,32 +12951,32 @@ ulong __ovld atom_sub(volatile __local ulong *p, ulong val);
1295112951 * with new value given by val. Returns old
1295212952 * value.
1295312953 */
12954int __ovld atomic_xchg(volatile __global int *p, int val);
12955uint __ovld atomic_xchg(volatile __global uint *p, uint val);
12956int __ovld atomic_xchg(volatile __local int *p, int val);
12957uint __ovld atomic_xchg(volatile __local uint *p, uint val);
12958float __ovld atomic_xchg(volatile __global float *p, float val);
12959float __ovld atomic_xchg(volatile __local float *p, float val);
12954int __ovld atomic_xchg(volatile __global int *, int);
12955uint __ovld atomic_xchg(volatile __global uint *, uint);
12956int __ovld atomic_xchg(volatile __local int *, int);
12957uint __ovld atomic_xchg(volatile __local uint *, uint);
12958float __ovld atomic_xchg(volatile __global float *, float);
12959float __ovld atomic_xchg(volatile __local float *, float);
1296012960#ifdef __OPENCL_CPP_VERSION__
12961int __ovld atomic_xchg(volatile int *p, int val);
12962uint __ovld atomic_xchg(volatile uint *p, uint val);
12963float __ovld atomic_xchg(volatile float *p, float val);
12961int __ovld atomic_xchg(volatile int *, int);
12962uint __ovld atomic_xchg(volatile uint *, uint);
12963float __ovld atomic_xchg(volatile float *, float);
1296412964#endif
1296512965
1296612966#if defined(cl_khr_global_int32_base_atomics)
12967int __ovld atom_xchg(volatile __global int *p, int val);
12968uint __ovld atom_xchg(volatile __global uint *p, uint val);
12967int __ovld atom_xchg(volatile __global int *, int);
12968uint __ovld atom_xchg(volatile __global uint *, uint);
1296912969#endif
1297012970#if defined(cl_khr_local_int32_base_atomics)
12971int __ovld atom_xchg(volatile __local int *p, int val);
12972uint __ovld atom_xchg(volatile __local uint *p, uint val);
12971int __ovld atom_xchg(volatile __local int *, int);
12972uint __ovld atom_xchg(volatile __local uint *, uint);
1297312973#endif
1297412974
1297512975#if defined(cl_khr_int64_base_atomics)
12976long __ovld atom_xchg(volatile __global long *p, long val);
12977long __ovld atom_xchg(volatile __local long *p, long val);
12978ulong __ovld atom_xchg(volatile __global ulong *p, ulong val);
12979ulong __ovld atom_xchg(volatile __local ulong *p, ulong val);
12976long __ovld atom_xchg(volatile __global long *, long);
12977long __ovld atom_xchg(volatile __local long *, long);
12978ulong __ovld atom_xchg(volatile __global ulong *, ulong);
12979ulong __ovld atom_xchg(volatile __local ulong *, ulong);
1298012980#endif
1298112981
1298212982/**
......@@ -13048,29 +13048,29 @@ ulong __ovld atom_dec(volatile __local ulong *);
1304813048 * location pointed by p. The function
1304913049 * returns old.
1305013050 */
13051int __ovld atomic_cmpxchg(volatile __global int *p, int cmp, int val);
13052uint __ovld atomic_cmpxchg(volatile __global uint *p, uint cmp, uint val);
13053int __ovld atomic_cmpxchg(volatile __local int *p, int cmp, int val);
13054uint __ovld atomic_cmpxchg(volatile __local uint *p, uint cmp, uint val);
13051int __ovld atomic_cmpxchg(volatile __global int *, int, int);
13052uint __ovld atomic_cmpxchg(volatile __global uint *, uint, uint);
13053int __ovld atomic_cmpxchg(volatile __local int *, int, int);
13054uint __ovld atomic_cmpxchg(volatile __local uint *, uint, uint);
1305513055#ifdef __OPENCL_CPP_VERSION__
13056int __ovld atomic_cmpxchg(volatile int *p, int cmp, int val);
13057uint __ovld atomic_cmpxchg(volatile uint *p, uint cmp, uint val);
13056int __ovld atomic_cmpxchg(volatile int *, int, int);
13057uint __ovld atomic_cmpxchg(volatile uint *, uint, uint);
1305813058#endif
1305913059
1306013060#if defined(cl_khr_global_int32_base_atomics)
13061int __ovld atom_cmpxchg(volatile __global int *p, int cmp, int val);
13062uint __ovld atom_cmpxchg(volatile __global uint *p, uint cmp, uint val);
13061int __ovld atom_cmpxchg(volatile __global int *, int, int);
13062uint __ovld atom_cmpxchg(volatile __global uint *, uint, uint);
1306313063#endif
1306413064#if defined(cl_khr_local_int32_base_atomics)
13065int __ovld atom_cmpxchg(volatile __local int *p, int cmp, int val);
13066uint __ovld atom_cmpxchg(volatile __local uint *p, uint cmp, uint val);
13065int __ovld atom_cmpxchg(volatile __local int *, int, int);
13066uint __ovld atom_cmpxchg(volatile __local uint *, uint, uint);
1306713067#endif
1306813068
1306913069#if defined(cl_khr_int64_base_atomics)
13070long __ovld atom_cmpxchg(volatile __global long *p, long cmp, long val);
13071ulong __ovld atom_cmpxchg(volatile __global ulong *p, ulong cmp, ulong val);
13072long __ovld atom_cmpxchg(volatile __local long *p, long cmp, long val);
13073ulong __ovld atom_cmpxchg(volatile __local ulong *p, ulong cmp, ulong val);
13070long __ovld atom_cmpxchg(volatile __global long *, long, long);
13071ulong __ovld atom_cmpxchg(volatile __global ulong *, ulong, ulong);
13072long __ovld atom_cmpxchg(volatile __local long *, long, long);
13073ulong __ovld atom_cmpxchg(volatile __local ulong *, ulong, ulong);
1307413074#endif
1307513075
1307613076/**
......@@ -13080,29 +13080,29 @@ ulong __ovld atom_cmpxchg(volatile __local ulong *p, ulong cmp, ulong val);
1308013080 * location pointed by p. The function
1308113081 * returns old.
1308213082 */
13083int __ovld atomic_min(volatile __global int *p, int val);
13084uint __ovld atomic_min(volatile __global uint *p, uint val);
13085int __ovld atomic_min(volatile __local int *p, int val);
13086uint __ovld atomic_min(volatile __local uint *p, uint val);
13083int __ovld atomic_min(volatile __global int *, int);
13084uint __ovld atomic_min(volatile __global uint *, uint);
13085int __ovld atomic_min(volatile __local int *, int);
13086uint __ovld atomic_min(volatile __local uint *, uint);
1308713087#ifdef __OPENCL_CPP_VERSION__
13088int __ovld atomic_min(volatile int *p, int val);
13089uint __ovld atomic_min(volatile uint *p, uint val);
13088int __ovld atomic_min(volatile int *, int);
13089uint __ovld atomic_min(volatile uint *, uint);
1309013090#endif
1309113091
1309213092#if defined(cl_khr_global_int32_extended_atomics)
13093int __ovld atom_min(volatile __global int *p, int val);
13094uint __ovld atom_min(volatile __global uint *p, uint val);
13093int __ovld atom_min(volatile __global int *, int);
13094uint __ovld atom_min(volatile __global uint *, uint);
1309513095#endif
1309613096#if defined(cl_khr_local_int32_extended_atomics)
13097int __ovld atom_min(volatile __local int *p, int val);
13098uint __ovld atom_min(volatile __local uint *p, uint val);
13097int __ovld atom_min(volatile __local int *, int);
13098uint __ovld atom_min(volatile __local uint *, uint);
1309913099#endif
1310013100
1310113101#if defined(cl_khr_int64_extended_atomics)
13102long __ovld atom_min(volatile __global long *p, long val);
13103ulong __ovld atom_min(volatile __global ulong *p, ulong val);
13104long __ovld atom_min(volatile __local long *p, long val);
13105ulong __ovld atom_min(volatile __local ulong *p, ulong val);
13102long __ovld atom_min(volatile __global long *, long);
13103ulong __ovld atom_min(volatile __global ulong *, ulong);
13104long __ovld atom_min(volatile __local long *, long);
13105ulong __ovld atom_min(volatile __local ulong *, ulong);
1310613106#endif
1310713107
1310813108/**
......@@ -13112,29 +13112,29 @@ ulong __ovld atom_min(volatile __local ulong *p, ulong val);
1311213112 * location pointed by p. The function
1311313113 * returns old.
1311413114 */
13115int __ovld atomic_max(volatile __global int *p, int val);
13116uint __ovld atomic_max(volatile __global uint *p, uint val);
13117int __ovld atomic_max(volatile __local int *p, int val);
13118uint __ovld atomic_max(volatile __local uint *p, uint val);
13115int __ovld atomic_max(volatile __global int *, int);
13116uint __ovld atomic_max(volatile __global uint *, uint);
13117int __ovld atomic_max(volatile __local int *, int);
13118uint __ovld atomic_max(volatile __local uint *, uint);
1311913119#ifdef __OPENCL_CPP_VERSION__
13120int __ovld atomic_max(volatile int *p, int val);
13121uint __ovld atomic_max(volatile uint *p, uint val);
13120int __ovld atomic_max(volatile int *, int);
13121uint __ovld atomic_max(volatile uint *, uint);
1312213122#endif
1312313123
1312413124#if defined(cl_khr_global_int32_extended_atomics)
13125int __ovld atom_max(volatile __global int *p, int val);
13126uint __ovld atom_max(volatile __global uint *p, uint val);
13125int __ovld atom_max(volatile __global int *, int);
13126uint __ovld atom_max(volatile __global uint *, uint);
1312713127#endif
1312813128#if defined(cl_khr_local_int32_extended_atomics)
13129int __ovld atom_max(volatile __local int *p, int val);
13130uint __ovld atom_max(volatile __local uint *p, uint val);
13129int __ovld atom_max(volatile __local int *, int);
13130uint __ovld atom_max(volatile __local uint *, uint);
1313113131#endif
1313213132
1313313133#if defined(cl_khr_int64_extended_atomics)
13134long __ovld atom_max(volatile __global long *p, long val);
13135ulong __ovld atom_max(volatile __global ulong *p, ulong val);
13136long __ovld atom_max(volatile __local long *p, long val);
13137ulong __ovld atom_max(volatile __local ulong *p, ulong val);
13134long __ovld atom_max(volatile __global long *, long);
13135ulong __ovld atom_max(volatile __global ulong *, ulong);
13136long __ovld atom_max(volatile __local long *, long);
13137ulong __ovld atom_max(volatile __local ulong *, ulong);
1313813138#endif
1313913139
1314013140/**
......@@ -13143,29 +13143,29 @@ ulong __ovld atom_max(volatile __local ulong *p, ulong val);
1314313143 * (old & val) and store result at location
1314413144 * pointed by p. The function returns old.
1314513145 */
13146int __ovld atomic_and(volatile __global int *p, int val);
13147uint __ovld atomic_and(volatile __global uint *p, uint val);
13148int __ovld atomic_and(volatile __local int *p, int val);
13149uint __ovld atomic_and(volatile __local uint *p, uint val);
13146int __ovld atomic_and(volatile __global int *, int);
13147uint __ovld atomic_and(volatile __global uint *, uint);
13148int __ovld atomic_and(volatile __local int *, int);
13149uint __ovld atomic_and(volatile __local uint *, uint);
1315013150#ifdef __OPENCL_CPP_VERSION__
13151int __ovld atomic_and(volatile int *p, int val);
13152uint __ovld atomic_and(volatile uint *p, uint val);
13151int __ovld atomic_and(volatile int *, int);
13152uint __ovld atomic_and(volatile uint *, uint);
1315313153#endif
1315413154
1315513155#if defined(cl_khr_global_int32_extended_atomics)
13156int __ovld atom_and(volatile __global int *p, int val);
13157uint __ovld atom_and(volatile __global uint *p, uint val);
13156int __ovld atom_and(volatile __global int *, int);
13157uint __ovld atom_and(volatile __global uint *, uint);
1315813158#endif
1315913159#if defined(cl_khr_local_int32_extended_atomics)
13160int __ovld atom_and(volatile __local int *p, int val);
13161uint __ovld atom_and(volatile __local uint *p, uint val);
13160int __ovld atom_and(volatile __local int *, int);
13161uint __ovld atom_and(volatile __local uint *, uint);
1316213162#endif
1316313163
1316413164#if defined(cl_khr_int64_extended_atomics)
13165long __ovld atom_and(volatile __global long *p, long val);
13166ulong __ovld atom_and(volatile __global ulong *p, ulong val);
13167long __ovld atom_and(volatile __local long *p, long val);
13168ulong __ovld atom_and(volatile __local ulong *p, ulong val);
13165long __ovld atom_and(volatile __global long *, long);
13166ulong __ovld atom_and(volatile __global ulong *, ulong);
13167long __ovld atom_and(volatile __local long *, long);
13168ulong __ovld atom_and(volatile __local ulong *, ulong);
1316913169#endif
1317013170
1317113171/**
......@@ -13174,29 +13174,29 @@ ulong __ovld atom_and(volatile __local ulong *p, ulong val);
1317413174 * (old | val) and store result at location
1317513175 * pointed by p. The function returns old.
1317613176 */
13177int __ovld atomic_or(volatile __global int *p, int val);
13178uint __ovld atomic_or(volatile __global uint *p, uint val);
13179int __ovld atomic_or(volatile __local int *p, int val);
13180uint __ovld atomic_or(volatile __local uint *p, uint val);
13177int __ovld atomic_or(volatile __global int *, int);
13178uint __ovld atomic_or(volatile __global uint *, uint);
13179int __ovld atomic_or(volatile __local int *, int);
13180uint __ovld atomic_or(volatile __local uint *, uint);
1318113181#ifdef __OPENCL_CPP_VERSION__
13182int __ovld atomic_or(volatile int *p, int val);
13183uint __ovld atomic_or(volatile uint *p, uint val);
13182int __ovld atomic_or(volatile int *, int);
13183uint __ovld atomic_or(volatile uint *, uint);
1318413184#endif
1318513185
1318613186#if defined(cl_khr_global_int32_extended_atomics)
13187int __ovld atom_or(volatile __global int *p, int val);
13188uint __ovld atom_or(volatile __global uint *p, uint val);
13187int __ovld atom_or(volatile __global int *, int);
13188uint __ovld atom_or(volatile __global uint *, uint);
1318913189#endif
1319013190#if defined(cl_khr_local_int32_extended_atomics)
13191int __ovld atom_or(volatile __local int *p, int val);
13192uint __ovld atom_or(volatile __local uint *p, uint val);
13191int __ovld atom_or(volatile __local int *, int);
13192uint __ovld atom_or(volatile __local uint *, uint);
1319313193#endif
1319413194
1319513195#if defined(cl_khr_int64_extended_atomics)
13196long __ovld atom_or(volatile __global long *p, long val);
13197ulong __ovld atom_or(volatile __global ulong *p, ulong val);
13198long __ovld atom_or(volatile __local long *p, long val);
13199ulong __ovld atom_or(volatile __local ulong *p, ulong val);
13196long __ovld atom_or(volatile __global long *, long);
13197ulong __ovld atom_or(volatile __global ulong *, ulong);
13198long __ovld atom_or(volatile __local long *, long);
13199ulong __ovld atom_or(volatile __local ulong *, ulong);
1320013200#endif
1320113201
1320213202/**
......@@ -13205,29 +13205,29 @@ ulong __ovld atom_or(volatile __local ulong *p, ulong val);
1320513205 * (old ^ val) and store result at location
1320613206 * pointed by p. The function returns old.
1320713207 */
13208int __ovld atomic_xor(volatile __global int *p, int val);
13209uint __ovld atomic_xor(volatile __global uint *p, uint val);
13210int __ovld atomic_xor(volatile __local int *p, int val);
13211uint __ovld atomic_xor(volatile __local uint *p, uint val);
13208int __ovld atomic_xor(volatile __global int *, int);
13209uint __ovld atomic_xor(volatile __global uint *, uint);
13210int __ovld atomic_xor(volatile __local int *, int);
13211uint __ovld atomic_xor(volatile __local uint *, uint);
1321213212#ifdef __OPENCL_CPP_VERSION__
13213int __ovld atomic_xor(volatile int *p, int val);
13214uint __ovld atomic_xor(volatile uint *p, uint val);
13213int __ovld atomic_xor(volatile int *, int);
13214uint __ovld atomic_xor(volatile uint *, uint);
1321513215#endif
1321613216
1321713217#if defined(cl_khr_global_int32_extended_atomics)
13218int __ovld atom_xor(volatile __global int *p, int val);
13219uint __ovld atom_xor(volatile __global uint *p, uint val);
13218int __ovld atom_xor(volatile __global int *, int);
13219uint __ovld atom_xor(volatile __global uint *, uint);
1322013220#endif
1322113221#if defined(cl_khr_local_int32_extended_atomics)
13222int __ovld atom_xor(volatile __local int *p, int val);
13223uint __ovld atom_xor(volatile __local uint *p, uint val);
13222int __ovld atom_xor(volatile __local int *, int);
13223uint __ovld atom_xor(volatile __local uint *, uint);
1322413224#endif
1322513225
1322613226#if defined(cl_khr_int64_extended_atomics)
13227long __ovld atom_xor(volatile __global long *p, long val);
13228ulong __ovld atom_xor(volatile __global ulong *p, ulong val);
13229long __ovld atom_xor(volatile __local long *p, long val);
13230ulong __ovld atom_xor(volatile __local ulong *p, ulong val);
13227long __ovld atom_xor(volatile __global long *, long);
13228ulong __ovld atom_xor(volatile __global ulong *, ulong);
13229long __ovld atom_xor(volatile __local long *, long);
13230ulong __ovld atom_xor(volatile __local ulong *, ulong);
1323113231#endif
1323213232
1323313233#if defined(cl_khr_int64_base_atomics) && defined(cl_khr_int64_extended_atomics)
......@@ -15257,13 +15257,17 @@ float4 __ovld __purefn read_imagef(read_only image2d_t, sampler_t, float2, float
1525715257int4 __ovld __purefn read_imagei(read_only image2d_t, sampler_t, float2, float);
1525815258uint4 __ovld __purefn read_imageui(read_only image2d_t, sampler_t, float2, float);
1525915259
15260#ifdef cl_khr_depth_images
1526015261float __ovld __purefn read_imagef(read_only image2d_depth_t, sampler_t, float2, float);
15262#endif // cl_khr_depth_images
1526115263
1526215264float4 __ovld __purefn read_imagef(read_only image2d_array_t, sampler_t, float4, float);
1526315265int4 __ovld __purefn read_imagei(read_only image2d_array_t, sampler_t, float4, float);
1526415266uint4 __ovld __purefn read_imageui(read_only image2d_array_t, sampler_t, float4, float);
1526515267
15268#ifdef cl_khr_depth_images
1526615269float __ovld __purefn read_imagef(read_only image2d_array_depth_t, sampler_t, float4, float);
15270#endif // cl_khr_depth_images
1526715271
1526815272float4 __ovld __purefn read_imagef(read_only image3d_t, sampler_t, float4, float);
1526915273int4 __ovld __purefn read_imagei(read_only image3d_t, sampler_t, float4, float);
......@@ -15281,13 +15285,17 @@ float4 __ovld __purefn read_imagef(read_only image2d_t, sampler_t, float2, float
1528115285int4 __ovld __purefn read_imagei(read_only image2d_t, sampler_t, float2, float2, float2);
1528215286uint4 __ovld __purefn read_imageui(read_only image2d_t, sampler_t, float2, float2, float2);
1528315287
15288#ifdef cl_khr_depth_images
1528415289float __ovld __purefn read_imagef(read_only image2d_depth_t, sampler_t, float2, float2, float2);
15290#endif // cl_khr_depth_images
1528515291
1528615292float4 __ovld __purefn read_imagef(read_only image2d_array_t, sampler_t, float4, float2, float2);
1528715293int4 __ovld __purefn read_imagei(read_only image2d_array_t, sampler_t, float4, float2, float2);
1528815294uint4 __ovld __purefn read_imageui(read_only image2d_array_t, sampler_t, float4, float2, float2);
1528915295
15296#ifdef cl_khr_depth_images
1529015297float __ovld __purefn read_imagef(read_only image2d_array_depth_t, sampler_t, float4, float2, float2);
15298#endif // cl_khr_depth_images
1529115299
1529215300float4 __ovld __purefn read_imagef(read_only image3d_t, sampler_t, float4, float4, float4);
1529315301int4 __ovld __purefn read_imagei(read_only image3d_t, sampler_t, float4, float4, float4);
......@@ -15380,9 +15388,11 @@ float4 __ovld __purefn read_imagef(read_write image2d_array_t, int4);
1538015388int4 __ovld __purefn read_imagei(read_write image2d_array_t, int4);
1538115389uint4 __ovld __purefn read_imageui(read_write image2d_array_t, int4);
1538215390
15391#ifdef cl_khr_3d_image_writes
1538315392float4 __ovld __purefn read_imagef(read_write image3d_t, int4);
1538415393int4 __ovld __purefn read_imagei(read_write image3d_t, int4);
1538515394uint4 __ovld __purefn read_imageui(read_write image3d_t, int4);
15395#endif // cl_khr_3d_image_writes
1538615396
1538715397#ifdef cl_khr_depth_images
1538815398float __ovld __purefn read_imagef(read_write image2d_depth_t, int2);
......@@ -15423,9 +15433,11 @@ uint4 __ovld __purefn read_imageui(read_write image2d_array_t, sampler_t, float4
1542315433
1542415434float __ovld __purefn read_imagef(read_write image2d_array_depth_t, sampler_t, float4, float);
1542515435
15436#ifdef cl_khr_3d_image_writes
1542615437float4 __ovld __purefn read_imagef(read_write image3d_t, sampler_t, float4, float);
1542715438int4 __ovld __purefn read_imagei(read_write image3d_t, sampler_t, float4, float);
1542815439uint4 __ovld __purefn read_imageui(read_write image3d_t, sampler_t, float4, float);
15440#endif // cl_khr_3d_image_writes
1542915441
1543015442float4 __ovld __purefn read_imagef(read_write image1d_t, sampler_t, float, float, float);
1543115443int4 __ovld __purefn read_imagei(read_write image1d_t, sampler_t, float, float, float);
......@@ -15447,9 +15459,11 @@ uint4 __ovld __purefn read_imageui(read_write image2d_array_t, sampler_t, float4
1544715459
1544815460float __ovld __purefn read_imagef(read_write image2d_array_depth_t, sampler_t, float4, float2, float2);
1544915461
15462#ifdef cl_khr_3d_image_writes
1545015463float4 __ovld __purefn read_imagef(read_write image3d_t, sampler_t, float4, float4, float4);
1545115464int4 __ovld __purefn read_imagei(read_write image3d_t, sampler_t, float4, float4, float4);
1545215465uint4 __ovld __purefn read_imageui(read_write image3d_t, sampler_t, float4, float4, float4);
15466#endif // cl_khr_3d_image_writes
1545315467
1545415468#endif //cl_khr_mipmap_image
1545515469
......@@ -15457,7 +15471,9 @@ uint4 __ovld __purefn read_imageui(read_write image3d_t, sampler_t, float4, floa
1545715471#ifdef cl_khr_fp16
1545815472half4 __ovld __purefn read_imageh(read_write image1d_t, int);
1545915473half4 __ovld __purefn read_imageh(read_write image2d_t, int2);
15474#ifdef cl_khr_3d_image_writes
1546015475half4 __ovld __purefn read_imageh(read_write image3d_t, int4);
15476#endif // cl_khr_3d_image_writes
1546115477half4 __ovld __purefn read_imageh(read_write image1d_array_t, int2);
1546215478half4 __ovld __purefn read_imageh(read_write image2d_array_t, int4);
1546315479half4 __ovld __purefn read_imageh(read_write image1d_buffer_t, int);
......@@ -15727,7 +15743,9 @@ int __ovld __cnfn get_image_width(write_only image2d_array_msaa_depth_t);
1572715743int __ovld __cnfn get_image_width(read_write image1d_t);
1572815744int __ovld __cnfn get_image_width(read_write image1d_buffer_t);
1572915745int __ovld __cnfn get_image_width(read_write image2d_t);
15746#ifdef cl_khr_3d_image_writes
1573015747int __ovld __cnfn get_image_width(read_write image3d_t);
15748#endif // cl_khr_3d_image_writes
1573115749int __ovld __cnfn get_image_width(read_write image1d_array_t);
1573215750int __ovld __cnfn get_image_width(read_write image2d_array_t);
1573315751#ifdef cl_khr_depth_images
......@@ -15777,7 +15795,9 @@ int __ovld __cnfn get_image_height(write_only image2d_array_msaa_depth_t);
1577715795
1577815796#if defined(__opencl_c_read_write_images)
1577915797int __ovld __cnfn get_image_height(read_write image2d_t);
15798#ifdef cl_khr_3d_image_writes
1578015799int __ovld __cnfn get_image_height(read_write image3d_t);
15800#endif // cl_khr_3d_image_writes
1578115801int __ovld __cnfn get_image_height(read_write image2d_array_t);
1578215802#ifdef cl_khr_depth_images
1578315803int __ovld __cnfn get_image_height(read_write image2d_depth_t);
......@@ -15798,11 +15818,11 @@ int __ovld __cnfn get_image_depth(read_only image3d_t);
1579815818
1579915819#ifdef cl_khr_3d_image_writes
1580015820int __ovld __cnfn get_image_depth(write_only image3d_t);
15801#endif
1580215821
1580315822#if defined(__opencl_c_read_write_images)
1580415823int __ovld __cnfn get_image_depth(read_write image3d_t);
1580515824#endif //defined(__opencl_c_read_write_images)
15825#endif // cl_khr_3d_image_writes
1580615826
1580715827// OpenCL Extension v2.0 s9.18 - Mipmaps
1580815828#if defined(__OPENCL_CPP_VERSION__) || (__OPENCL_C_VERSION__ >= CL_VERSION_2_0)
......@@ -15824,24 +15844,32 @@ int __ovld get_image_num_mip_levels(write_only image3d_t);
1582415844#if defined(__opencl_c_read_write_images)
1582515845int __ovld get_image_num_mip_levels(read_write image1d_t);
1582615846int __ovld get_image_num_mip_levels(read_write image2d_t);
15847#ifdef cl_khr_3d_image_writes
1582715848int __ovld get_image_num_mip_levels(read_write image3d_t);
15849#endif // cl_khr_3d_image_writes
1582815850#endif //defined(__opencl_c_read_write_images)
1582915851
1583015852int __ovld get_image_num_mip_levels(read_only image1d_array_t);
1583115853int __ovld get_image_num_mip_levels(read_only image2d_array_t);
15854#ifdef cl_khr_depth_images
1583215855int __ovld get_image_num_mip_levels(read_only image2d_array_depth_t);
1583315856int __ovld get_image_num_mip_levels(read_only image2d_depth_t);
15857#endif // cl_khr_depth_images
1583415858
1583515859int __ovld get_image_num_mip_levels(write_only image1d_array_t);
1583615860int __ovld get_image_num_mip_levels(write_only image2d_array_t);
15861#ifdef cl_khr_depth_images
1583715862int __ovld get_image_num_mip_levels(write_only image2d_array_depth_t);
1583815863int __ovld get_image_num_mip_levels(write_only image2d_depth_t);
15864#endif // cl_khr_depth_images
1583915865
1584015866#if defined(__opencl_c_read_write_images)
1584115867int __ovld get_image_num_mip_levels(read_write image1d_array_t);
1584215868int __ovld get_image_num_mip_levels(read_write image2d_array_t);
15869#ifdef cl_khr_depth_images
1584315870int __ovld get_image_num_mip_levels(read_write image2d_array_depth_t);
1584415871int __ovld get_image_num_mip_levels(read_write image2d_depth_t);
15872#endif // cl_khr_depth_images
1584515873#endif //defined(__opencl_c_read_write_images)
1584615874
1584715875#endif //cl_khr_mipmap_image
......@@ -15906,7 +15934,9 @@ int __ovld __cnfn get_image_channel_data_type(write_only image2d_array_msaa_dept
1590615934int __ovld __cnfn get_image_channel_data_type(read_write image1d_t);
1590715935int __ovld __cnfn get_image_channel_data_type(read_write image1d_buffer_t);
1590815936int __ovld __cnfn get_image_channel_data_type(read_write image2d_t);
15937#ifdef cl_khr_3d_image_writes
1590915938int __ovld __cnfn get_image_channel_data_type(read_write image3d_t);
15939#endif // cl_khr_3d_image_writes
1591015940int __ovld __cnfn get_image_channel_data_type(read_write image1d_array_t);
1591115941int __ovld __cnfn get_image_channel_data_type(read_write image2d_array_t);
1591215942#ifdef cl_khr_depth_images
......@@ -15978,7 +16008,9 @@ int __ovld __cnfn get_image_channel_order(write_only image2d_array_msaa_depth_t)
1597816008int __ovld __cnfn get_image_channel_order(read_write image1d_t);
1597916009int __ovld __cnfn get_image_channel_order(read_write image1d_buffer_t);
1598016010int __ovld __cnfn get_image_channel_order(read_write image2d_t);
16011#ifdef cl_khr_3d_image_writes
1598116012int __ovld __cnfn get_image_channel_order(read_write image3d_t);
16013#endif // cl_khr_3d_image_writes
1598216014int __ovld __cnfn get_image_channel_order(read_write image1d_array_t);
1598316015int __ovld __cnfn get_image_channel_order(read_write image2d_array_t);
1598416016#ifdef cl_khr_depth_images
......@@ -16048,10 +16080,10 @@ int2 __ovld __cnfn get_image_dim(read_write image2d_array_msaa_depth_t);
1604816080int4 __ovld __cnfn get_image_dim(read_only image3d_t);
1604916081#ifdef cl_khr_3d_image_writes
1605016082int4 __ovld __cnfn get_image_dim(write_only image3d_t);
16051#endif
1605216083#if defined(__opencl_c_read_write_images)
1605316084int4 __ovld __cnfn get_image_dim(read_write image3d_t);
1605416085#endif //defined(__opencl_c_read_write_images)
16086#endif // cl_khr_3d_image_writes
1605516087
1605616088/**
1605716089 * Return the image array size.
......@@ -16266,9 +16298,9 @@ uint __ovld get_enqueued_num_sub_groups(void);
1626616298uint __ovld get_sub_group_id(void);
1626716299uint __ovld get_sub_group_local_id(void);
1626816300
16269void __ovld __conv sub_group_barrier(cl_mem_fence_flags flags);
16301void __ovld __conv sub_group_barrier(cl_mem_fence_flags);
1627016302#if defined(__OPENCL_CPP_VERSION__) || (__OPENCL_C_VERSION__ >= CL_VERSION_2_0)
16271void __ovld __conv sub_group_barrier(cl_mem_fence_flags flags, memory_scope);
16303void __ovld __conv sub_group_barrier(cl_mem_fence_flags, memory_scope);
1627216304#endif //defined(__OPENCL_CPP_VERSION__) || (__OPENCL_C_VERSION__ >= CL_VERSION_2_0)
1627316305
1627416306int __ovld __conv sub_group_all(int predicate);
......@@ -17847,15 +17879,13 @@ intel_sub_group_avc_sic_configure_skc(
1784717879 uint skip_block_partition_type, uint skip_motion_vector_mask,
1784817880 ulong motion_vectors, uchar bidirectional_weight, uchar skip_sad_adjustment,
1784917881 intel_sub_group_avc_sic_payload_t payload);
17850intel_sub_group_avc_sic_payload_t __ovld
17851intel_sub_group_avc_sic_configure_ipe(
17852 uchar luma_intra_partition_mask, uchar intra_neighbour_availabilty,
17882intel_sub_group_avc_sic_payload_t __ovld intel_sub_group_avc_sic_configure_ipe(
17883 uchar luma_intra_partition_mask, uchar intra_neighbour_availability,
1785317884 uchar left_edge_luma_pixels, uchar upper_left_corner_luma_pixel,
1785417885 uchar upper_edge_luma_pixels, uchar upper_right_edge_luma_pixels,
1785517886 uchar intra_sad_adjustment, intel_sub_group_avc_sic_payload_t payload);
17856intel_sub_group_avc_sic_payload_t __ovld
17857intel_sub_group_avc_sic_configure_ipe(
17858 uchar luma_intra_partition_mask, uchar intra_neighbour_availabilty,
17887intel_sub_group_avc_sic_payload_t __ovld intel_sub_group_avc_sic_configure_ipe(
17888 uchar luma_intra_partition_mask, uchar intra_neighbour_availability,
1785917889 uchar left_edge_luma_pixels, uchar upper_left_corner_luma_pixel,
1786017890 uchar upper_edge_luma_pixels, uchar upper_right_edge_luma_pixels,
1786117891 ushort left_edge_chroma_pixels, ushort upper_left_corner_chroma_pixel,
lib/include/ppc_wrappers/emmintrin.h+2-2
......@@ -36,7 +36,7 @@
3636#ifndef EMMINTRIN_H_
3737#define EMMINTRIN_H_
3838
39#if defined(__ppc64__) && \
39#if defined(__powerpc64__) && \
4040 (defined(__linux__) || defined(__FreeBSD__) || defined(_AIX))
4141
4242#include <altivec.h>
......@@ -2262,7 +2262,7 @@ extern __inline __m128d
22622262
22632263#else
22642264#include_next <emmintrin.h>
2265#endif /* defined(__ppc64__) &&
2265#endif /* defined(__powerpc64__) && \
22662266 * (defined(__linux__) || defined(__FreeBSD__) || defined(_AIX)) */
22672267
22682268#endif /* EMMINTRIN_H_ */
lib/include/ppc_wrappers/mm_malloc.h+1-1
......@@ -10,7 +10,7 @@
1010#ifndef _MM_MALLOC_H_INCLUDED
1111#define _MM_MALLOC_H_INCLUDED
1212
13#if defined(__ppc64__) && \
13#if defined(__powerpc64__) && \
1414 (defined(__linux__) || defined(__FreeBSD__) || defined(_AIX))
1515
1616#include <stdlib.h>
lib/include/ppc_wrappers/mmintrin.h+2-2
......@@ -35,7 +35,7 @@
3535#ifndef _MMINTRIN_H_INCLUDED
3636#define _MMINTRIN_H_INCLUDED
3737
38#if defined(__ppc64__) && \
38#if defined(__powerpc64__) && \
3939 (defined(__linux__) || defined(__FreeBSD__) || defined(_AIX))
4040
4141#include <altivec.h>
......@@ -1447,7 +1447,7 @@ extern __inline __m64
14471447
14481448#else
14491449#include_next <mmintrin.h>
1450#endif /* defined(__ppc64__) &&
1450#endif /* defined(__powerpc64__) && \
14511451 * (defined(__linux__) || defined(__FreeBSD__) || defined(_AIX)) */
14521452
14531453#endif /* _MMINTRIN_H_INCLUDED */
lib/include/ppc_wrappers/pmmintrin.h+2-2
......@@ -39,7 +39,7 @@
3939#ifndef PMMINTRIN_H_
4040#define PMMINTRIN_H_
4141
42#if defined(__ppc64__) && \
42#if defined(__powerpc64__) && \
4343 (defined(__linux__) || defined(__FreeBSD__) || defined(_AIX))
4444
4545/* We need definitions from the SSE2 and SSE header files*/
......@@ -139,7 +139,7 @@ extern __inline __m128i
139139
140140#else
141141#include_next <pmmintrin.h>
142#endif /* defined(__ppc64__) &&
142#endif /* defined(__powerpc64__) && \
143143 * (defined(__linux__) || defined(__FreeBSD__) || defined(_AIX)) */
144144
145145#endif /* PMMINTRIN_H_ */
lib/include/ppc_wrappers/smmintrin.h+2-2
......@@ -29,7 +29,7 @@
2929#ifndef SMMINTRIN_H_
3030#define SMMINTRIN_H_
3131
32#if defined(__ppc64__) && \
32#if defined(__powerpc64__) && \
3333 (defined(__linux__) || defined(__FreeBSD__) || defined(_AIX))
3434
3535#include <altivec.h>
......@@ -657,7 +657,7 @@ extern __inline __m128i
657657
658658#else
659659#include_next <smmintrin.h>
660#endif /* defined(__ppc64__) &&
660#endif /* defined(__powerpc64__) && \
661661 * (defined(__linux__) || defined(__FreeBSD__) || defined(_AIX)) */
662662
663663#endif /* SMMINTRIN_H_ */
lib/include/ppc_wrappers/tmmintrin.h+2-2
......@@ -25,7 +25,7 @@
2525#ifndef TMMINTRIN_H_
2626#define TMMINTRIN_H_
2727
28#if defined(__ppc64__) && \
28#if defined(__powerpc64__) && \
2929 (defined(__linux__) || defined(__FreeBSD__) || defined(_AIX))
3030
3131#include <altivec.h>
......@@ -447,7 +447,7 @@ extern __inline __m64
447447
448448#else
449449#include_next <tmmintrin.h>
450#endif /* defined(__ppc64__) &&
450#endif /* defined(__powerpc64__) && \
451451 * (defined(__linux__) || defined(__FreeBSD__) || defined(_AIX)) */
452452
453453#endif /* TMMINTRIN_H_ */
lib/include/ppc_wrappers/xmmintrin.h+2-2
......@@ -35,7 +35,7 @@
3535#ifndef XMMINTRIN_H_
3636#define XMMINTRIN_H_
3737
38#if defined(__ppc64__) && \
38#if defined(__powerpc64__) && \
3939 (defined(__linux__) || defined(__FreeBSD__) || defined(_AIX))
4040
4141/* Define four value permute mask */
......@@ -1821,7 +1821,7 @@ extern __inline void
18211821
18221822#else
18231823#include_next <xmmintrin.h>
1824#endif /* defined(__ppc64__) &&
1824#endif /* defined(__powerpc64__) && \
18251825 * (defined(__linux__) || defined(__FreeBSD__) || defined(_AIX)) */
18261826
18271827#endif /* XMMINTRIN_H_ */
lib/include/prfchiintrin.h created+61
......@@ -0,0 +1,61 @@
1/*===---- prfchiintrin.h - PREFETCHI intrinsic -----------------------------===
2 *
3 * Part of the LLVM Project, under the Apache License v2.0 with LLVM Exceptions.
4 * See https://llvm.org/LICENSE.txt for license information.
5 * SPDX-License-Identifier: Apache-2.0 WITH LLVM-exception
6 *
7 *===-----------------------------------------------------------------------===
8 */
9
10#ifndef __PRFCHIINTRIN_H
11#define __PRFCHIINTRIN_H
12
13#ifdef __x86_64__
14
15/* Define the default attributes for the functions in this file. */
16#define __DEFAULT_FN_ATTRS \
17 __attribute__((__always_inline__, __nodebug__, __target__("prefetchi")))
18
19/// Loads an instruction sequence containing the specified memory address into
20/// all level cache.
21///
22/// Note that the effect of this intrinsic is dependent on the processor
23/// implementation.
24///
25/// \headerfile <x86intrin.h>
26///
27/// This intrinsic corresponds to the \c PREFETCHIT0 instruction.
28///
29/// \param __P
30/// A pointer specifying the memory address to be prefetched.
31static __inline__ void __DEFAULT_FN_ATTRS
32_m_prefetchit0(volatile const void *__P) {
33#pragma clang diagnostic push
34#pragma clang diagnostic ignored "-Wcast-qual"
35 __builtin_ia32_prefetchi((const void *)__P, 3 /* _MM_HINT_T0 */);
36#pragma clang diagnostic pop
37}
38
39/// Loads an instruction sequence containing the specified memory address into
40/// all but the first-level cache.
41///
42/// Note that the effect of this intrinsic is dependent on the processor
43/// implementation.
44///
45/// \headerfile <x86intrin.h>
46///
47/// This intrinsic corresponds to the \c PREFETCHIT1 instruction.
48///
49/// \param __P
50/// A pointer specifying the memory address to be prefetched.
51static __inline__ void __DEFAULT_FN_ATTRS
52_m_prefetchit1(volatile const void *__P) {
53#pragma clang diagnostic push
54#pragma clang diagnostic ignored "-Wcast-qual"
55 __builtin_ia32_prefetchi((const void *)__P, 2 /* _MM_HINT_T1 */);
56#pragma clang diagnostic pop
57}
58#endif /* __x86_64__ */
59#undef __DEFAULT_FN_ATTRS
60
61#endif /* __PRFCHWINTRIN_H */
lib/include/raointintrin.h created+203
......@@ -0,0 +1,203 @@
1/*===----------------------- raointintrin.h - RAOINT ------------------------===
2 *
3 * Part of the LLVM Project, under the Apache License v2.0 with LLVM Exceptions.
4 * See https://llvm.org/LICENSE.txt for license information.
5 * SPDX-License-Identifier: Apache-2.0 WITH LLVM-exception
6 *
7 *===-----------------------------------------------------------------------===
8 */
9
10#ifndef __X86GPRINTRIN_H
11#error "Never use <raointintrin.h> directly; include <x86gprintrin.h> instead."
12#endif // __X86GPRINTRIN_H
13
14#ifndef __RAOINTINTRIN_H
15#define __RAOINTINTRIN_H
16
17#define __DEFAULT_FN_ATTRS \
18 __attribute__((__always_inline__, __nodebug__, __target__("raoint")))
19
20/// Atomically add a 32-bit value at memory operand \a __A and a 32-bit \a __B,
21/// and store the result to the same memory location.
22///
23/// This intrinsic should be used for contention or weak ordering. It may
24/// result in bad performance for hot data used by single thread only.
25///
26/// \headerfile <x86intrin.h>
27///
28/// This intrinsic corresponds to the \c AADD instruction.
29///
30/// \param __A
31/// A pointer to a 32-bit memory location.
32/// \param __B
33/// A 32-bit integer value.
34///
35/// \code{.operation}
36/// MEM[__A+31:__A] := MEM[__A+31:__A] + __B[31:0]
37/// \endcode
38static __inline__ void __DEFAULT_FN_ATTRS _aadd_i32(int *__A, int __B) {
39 __builtin_ia32_aadd32((int *)__A, __B);
40}
41
42/// Atomically and a 32-bit value at memory operand \a __A and a 32-bit \a __B,
43/// and store the result to the same memory location.
44///
45/// This intrinsic should be used for contention or weak ordering. It may
46/// result in bad performance for hot data used by single thread only.
47///
48/// \headerfile <x86intrin.h>
49///
50/// This intrinsic corresponds to the \c AAND instruction.
51///
52/// \param __A
53/// A pointer to a 32-bit memory location.
54/// \param __B
55/// A 32-bit integer value.
56///
57/// \code{.operation}
58/// MEM[__A+31:__A] := MEM[__A+31:__A] AND __B[31:0]
59/// \endcode
60static __inline__ void __DEFAULT_FN_ATTRS _aand_i32(int *__A, int __B) {
61 __builtin_ia32_aand32((int *)__A, __B);
62}
63
64/// Atomically or a 32-bit value at memory operand \a __A and a 32-bit \a __B,
65/// and store the result to the same memory location.
66///
67/// This intrinsic should be used for contention or weak ordering. It may
68/// result in bad performance for hot data used by single thread only.
69///
70/// \headerfile <x86intrin.h>
71///
72/// This intrinsic corresponds to the \c AOR instruction.
73///
74/// \param __A
75/// A pointer to a 32-bit memory location.
76/// \param __B
77/// A 32-bit integer value.
78///
79/// \code{.operation}
80/// MEM[__A+31:__A] := MEM[__A+31:__A] OR __B[31:0]
81/// \endcode
82static __inline__ void __DEFAULT_FN_ATTRS _aor_i32(int *__A, int __B) {
83 __builtin_ia32_aor32((int *)__A, __B);
84}
85
86/// Atomically xor a 32-bit value at memory operand \a __A and a 32-bit \a __B,
87/// and store the result to the same memory location.
88///
89/// This intrinsic should be used for contention or weak ordering. It may
90/// result in bad performance for hot data used by single thread only.
91///
92/// \headerfile <x86intrin.h>
93///
94/// This intrinsic corresponds to the \c AXOR instruction.
95///
96/// \param __A
97/// A pointer to a 32-bit memory location.
98/// \param __B
99/// A 32-bit integer value.
100///
101/// \code{.operation}
102/// MEM[__A+31:__A] := MEM[__A+31:__A] XOR __B[31:0]
103/// \endcode
104static __inline__ void __DEFAULT_FN_ATTRS _axor_i32(int *__A, int __B) {
105 __builtin_ia32_axor32((int *)__A, __B);
106}
107
108#ifdef __x86_64__
109/// Atomically add a 64-bit value at memory operand \a __A and a 64-bit \a __B,
110/// and store the result to the same memory location.
111///
112/// This intrinsic should be used for contention or weak ordering. It may
113/// result in bad performance for hot data used by single thread only.
114///
115/// \headerfile <x86intrin.h>
116///
117/// This intrinsic corresponds to the \c AADD instruction.
118///
119/// \param __A
120/// A pointer to a 64-bit memory location.
121/// \param __B
122/// A 64-bit integer value.
123///
124/// \code{.operation}
125/// MEM[__A+63:__A] := MEM[__A+63:__A] + __B[63:0]
126/// \endcode
127static __inline__ void __DEFAULT_FN_ATTRS _aadd_i64(long long *__A,
128 long long __B) {
129 __builtin_ia32_aadd64((long long *)__A, __B);
130}
131
132/// Atomically and a 64-bit value at memory operand \a __A and a 64-bit \a __B,
133/// and store the result to the same memory location.
134///
135/// This intrinsic should be used for contention or weak ordering. It may
136/// result in bad performance for hot data used by single thread only.
137///
138/// \headerfile <x86intrin.h>
139///
140/// This intrinsic corresponds to the \c AAND instruction.
141///
142/// \param __A
143/// A pointer to a 64-bit memory location.
144/// \param __B
145/// A 64-bit integer value.
146///
147/// \code{.operation}
148/// MEM[__A+63:__A] := MEM[__A+63:__A] AND __B[63:0]
149/// \endcode
150static __inline__ void __DEFAULT_FN_ATTRS _aand_i64(long long *__A,
151 long long __B) {
152 __builtin_ia32_aand64((long long *)__A, __B);
153}
154
155/// Atomically or a 64-bit value at memory operand \a __A and a 64-bit \a __B,
156/// and store the result to the same memory location.
157///
158/// This intrinsic should be used for contention or weak ordering. It may
159/// result in bad performance for hot data used by single thread only.
160///
161/// \headerfile <x86intrin.h>
162///
163/// This intrinsic corresponds to the \c AOR instruction.
164///
165/// \param __A
166/// A pointer to a 64-bit memory location.
167/// \param __B
168/// A 64-bit integer value.
169///
170/// \code{.operation}
171/// MEM[__A+63:__A] := MEM[__A+63:__A] OR __B[63:0]
172/// \endcode
173static __inline__ void __DEFAULT_FN_ATTRS _aor_i64(long long *__A,
174 long long __B) {
175 __builtin_ia32_aor64((long long *)__A, __B);
176}
177
178/// Atomically xor a 64-bit value at memory operand \a __A and a 64-bit \a __B,
179/// and store the result to the same memory location.
180///
181/// This intrinsic should be used for contention or weak ordering. It may
182/// result in bad performance for hot data used by single thread only.
183///
184/// \headerfile <x86intrin.h>
185///
186/// This intrinsic corresponds to the \c AXOR instruction.
187///
188/// \param __A
189/// A pointer to a 64-bit memory location.
190/// \param __B
191/// A 64-bit integer value.
192///
193/// \code{.operation}
194/// MEM[__A+63:__A] := MEM[__A+63:__A] XOR __B[63:0]
195/// \endcode
196static __inline__ void __DEFAULT_FN_ATTRS _axor_i64(long long *__A,
197 long long __B) {
198 __builtin_ia32_axor64((long long *)__A, __B);
199}
200#endif // __x86_64__
201
202#undef __DEFAULT_FN_ATTRS
203#endif // __RAOINTINTRIN_H
lib/include/riscv_vector.h+15-6
......@@ -25,6 +25,8 @@ extern "C" {
2525#pragma clang riscv intrinsic vector
2626
2727
28#define vlenb() __builtin_rvv_vlenb()
29
2830enum RVV_CSR {
2931 RVV_VSTART = 0,
3032 RVV_VXSAT,
......@@ -70,7 +72,6 @@ void vwrite_csr(enum RVV_CSR __csr, unsigned long __value) {
7072 }
7173}
7274
73#define vsetvl_e8mf8(avl) __builtin_rvv_vsetvli((size_t)(avl), 0, 5)
7475#define vsetvl_e8mf4(avl) __builtin_rvv_vsetvli((size_t)(avl), 0, 6)
7576#define vsetvl_e8mf2(avl) __builtin_rvv_vsetvli((size_t)(avl), 0, 7)
7677#define vsetvl_e8m1(avl) __builtin_rvv_vsetvli((size_t)(avl), 0, 0)
......@@ -78,25 +79,28 @@ void vwrite_csr(enum RVV_CSR __csr, unsigned long __value) {
7879#define vsetvl_e8m4(avl) __builtin_rvv_vsetvli((size_t)(avl), 0, 2)
7980#define vsetvl_e8m8(avl) __builtin_rvv_vsetvli((size_t)(avl), 0, 3)
8081
81#define vsetvl_e16mf4(avl) __builtin_rvv_vsetvli((size_t)(avl), 1, 6)
8282#define vsetvl_e16mf2(avl) __builtin_rvv_vsetvli((size_t)(avl), 1, 7)
8383#define vsetvl_e16m1(avl) __builtin_rvv_vsetvli((size_t)(avl), 1, 0)
8484#define vsetvl_e16m2(avl) __builtin_rvv_vsetvli((size_t)(avl), 1, 1)
8585#define vsetvl_e16m4(avl) __builtin_rvv_vsetvli((size_t)(avl), 1, 2)
8686#define vsetvl_e16m8(avl) __builtin_rvv_vsetvli((size_t)(avl), 1, 3)
8787
88#define vsetvl_e32mf2(avl) __builtin_rvv_vsetvli((size_t)(avl), 2, 7)
8988#define vsetvl_e32m1(avl) __builtin_rvv_vsetvli((size_t)(avl), 2, 0)
9089#define vsetvl_e32m2(avl) __builtin_rvv_vsetvli((size_t)(avl), 2, 1)
9190#define vsetvl_e32m4(avl) __builtin_rvv_vsetvli((size_t)(avl), 2, 2)
9291#define vsetvl_e32m8(avl) __builtin_rvv_vsetvli((size_t)(avl), 2, 3)
9392
93#if __riscv_v_elen >= 64
94#define vsetvl_e8mf8(avl) __builtin_rvv_vsetvli((size_t)(avl), 0, 5)
95#define vsetvl_e16mf4(avl) __builtin_rvv_vsetvli((size_t)(avl), 1, 6)
96#define vsetvl_e32mf2(avl) __builtin_rvv_vsetvli((size_t)(avl), 2, 7)
97
9498#define vsetvl_e64m1(avl) __builtin_rvv_vsetvli((size_t)(avl), 3, 0)
9599#define vsetvl_e64m2(avl) __builtin_rvv_vsetvli((size_t)(avl), 3, 1)
96100#define vsetvl_e64m4(avl) __builtin_rvv_vsetvli((size_t)(avl), 3, 2)
97101#define vsetvl_e64m8(avl) __builtin_rvv_vsetvli((size_t)(avl), 3, 3)
102#endif
98103
99#define vsetvlmax_e8mf8() __builtin_rvv_vsetvlimax(0, 5)
100104#define vsetvlmax_e8mf4() __builtin_rvv_vsetvlimax(0, 6)
101105#define vsetvlmax_e8mf2() __builtin_rvv_vsetvlimax(0, 7)
102106#define vsetvlmax_e8m1() __builtin_rvv_vsetvlimax(0, 0)
......@@ -104,23 +108,28 @@ void vwrite_csr(enum RVV_CSR __csr, unsigned long __value) {
104108#define vsetvlmax_e8m4() __builtin_rvv_vsetvlimax(0, 2)
105109#define vsetvlmax_e8m8() __builtin_rvv_vsetvlimax(0, 3)
106110
107#define vsetvlmax_e16mf4() __builtin_rvv_vsetvlimax(1, 6)
108111#define vsetvlmax_e16mf2() __builtin_rvv_vsetvlimax(1, 7)
109112#define vsetvlmax_e16m1() __builtin_rvv_vsetvlimax(1, 0)
110113#define vsetvlmax_e16m2() __builtin_rvv_vsetvlimax(1, 1)
111114#define vsetvlmax_e16m4() __builtin_rvv_vsetvlimax(1, 2)
112115#define vsetvlmax_e16m8() __builtin_rvv_vsetvlimax(1, 3)
113116
114#define vsetvlmax_e32mf2() __builtin_rvv_vsetvlimax(2, 7)
115117#define vsetvlmax_e32m1() __builtin_rvv_vsetvlimax(2, 0)
116118#define vsetvlmax_e32m2() __builtin_rvv_vsetvlimax(2, 1)
117119#define vsetvlmax_e32m4() __builtin_rvv_vsetvlimax(2, 2)
118120#define vsetvlmax_e32m8() __builtin_rvv_vsetvlimax(2, 3)
119121
122#if __riscv_v_elen >= 64
123#define vsetvlmax_e8mf8() __builtin_rvv_vsetvlimax(0, 5)
124#define vsetvlmax_e16mf4() __builtin_rvv_vsetvlimax(1, 6)
125#define vsetvlmax_e32mf2() __builtin_rvv_vsetvlimax(2, 7)
126
120127#define vsetvlmax_e64m1() __builtin_rvv_vsetvlimax(3, 0)
121128#define vsetvlmax_e64m2() __builtin_rvv_vsetvlimax(3, 1)
122129#define vsetvlmax_e64m4() __builtin_rvv_vsetvlimax(3, 2)
123130#define vsetvlmax_e64m8() __builtin_rvv_vsetvlimax(3, 3)
131#endif
132
124133typedef __rvv_bool64_t vbool64_t;
125134typedef __rvv_bool32_t vbool32_t;
126135typedef __rvv_bool16_t vbool16_t;
lib/include/smmintrin.h+1-1
......@@ -818,7 +818,7 @@ static __inline__ __m128i __DEFAULT_FN_ATTRS _mm_max_epu32(__m128i __V1,
818818/// parameter, is copied to the result.
819819/// \param N
820820/// Specifies which bits from operand \a Y will be copied, which bits in the
821/// result they will be be copied to, and which bits in the result will be
821/// result they will be copied to, and which bits in the result will be
822822/// cleared. The following assignments are made: \n
823823/// Bits [7:6] specify the bits to copy from operand \a Y: \n
824824/// 00: Selects bits [31:0] from operand \a Y. \n
lib/include/stdarg.h+23-7
......@@ -8,13 +8,30 @@
88 */
99
1010#ifndef __STDARG_H
11#define __STDARG_H
1211
12#ifndef __GNUC_VA_LIST
13#define __GNUC_VA_LIST
14typedef __builtin_va_list __gnuc_va_list;
15#endif
16
17#ifdef __need___va_list
18#undef __need___va_list
19#else
20#define __STDARG_H
1321#ifndef _VA_LIST
1422typedef __builtin_va_list va_list;
1523#define _VA_LIST
1624#endif
25
26/* FIXME: This is using the placeholder dates Clang produces for these macros
27 in C2x mode; switch to the correct values once they've been published. */
28#if defined(__STDC_VERSION__) && __STDC_VERSION__ >= 202000L
29/* C2x does not require the second parameter for va_start. */
30#define va_start(ap, ...) __builtin_va_start(ap, 0)
31#else
32/* Versions before C2x do require the second parameter. */
1733#define va_start(ap, param) __builtin_va_start(ap, param)
34#endif
1835#define va_end(ap) __builtin_va_end(ap)
1936#define va_arg(ap, type) __builtin_va_arg(ap, type)
2037
......@@ -23,13 +40,12 @@ typedef __builtin_va_list va_list;
2340 */
2441#define __va_copy(d,s) __builtin_va_copy(d,s)
2542
26#if __STDC_VERSION__ >= 199901L || __cplusplus >= 201103L || !defined(__STRICT_ANSI__)
43#if (defined(__STDC_VERSION__) && __STDC_VERSION__ >= 199901L) || \
44 (defined(__cplusplus) && __cplusplus >= 201103L) || \
45 !defined(__STRICT_ANSI__)
2746#define va_copy(dest, src) __builtin_va_copy(dest, src)
2847#endif
2948
30#ifndef __GNUC_VA_LIST
31#define __GNUC_VA_LIST 1
32typedef __builtin_va_list __gnuc_va_list;
33#endif
34
3549#endif /* __STDARG_H */
50
51#endif /* not __STDARG_H */
lib/include/stdatomic.h+6-3
......@@ -15,10 +15,12 @@
1515 *
1616 * Exclude the MSVC path as well as the MSVC header as of the 14.31.30818
1717 * explicitly disallows `stdatomic.h` in the C mode via an `#error`. Fallback
18 * to the clang resource header until that is fully supported.
18 * to the clang resource header until that is fully supported. The
19 * `stdatomic.h` header requires C++ 23 or newer.
1920 */
2021#if __STDC_HOSTED__ && \
21 __has_include_next(<stdatomic.h>) && !(defined(_MSC_VER) && !defined(__cplusplus))
22 __has_include_next(<stdatomic.h>) && \
23 (!defined(_MSC_VER) || (defined(__cplusplus) && __cplusplus >= 202002L))
2224# include_next <stdatomic.h>
2325#else
2426
......@@ -45,7 +47,8 @@ extern "C" {
4547/* 7.17.2 Initialization */
4648
4749#define ATOMIC_VAR_INIT(value) (value)
48#if (__STDC_VERSION__ >= 201710L || __cplusplus >= 202002L) && \
50#if ((defined(__STDC_VERSION__) && __STDC_VERSION__ >= 201710L) || \
51 (defined(__cplusplus) && __cplusplus >= 202002L)) && \
4952 !defined(_CLANG_DISABLE_CRT_DEPRECATION_WARNINGS)
5053/* ATOMIC_VAR_INIT was deprecated in C17 and C++20. */
5154#pragma clang deprecated(ATOMIC_VAR_INIT)
lib/include/stdbool.h+2-2
......@@ -12,7 +12,7 @@
1212
1313#define __bool_true_false_are_defined 1
1414
15#if __STDC_VERSION__ > 201710L
15#if defined(__STDC_VERSION__) && __STDC_VERSION__ > 201710L
1616/* FIXME: We should be issuing a deprecation warning here, but cannot yet due
1717 * to system headers which include this header file unconditionally.
1818 */
......@@ -23,7 +23,7 @@
2323#elif defined(__GNUC__) && !defined(__STRICT_ANSI__)
2424/* Define _Bool as a GNU extension. */
2525#define _Bool bool
26#if __cplusplus < 201103L
26#if defined(__cplusplus) && __cplusplus < 201103L
2727/* For C++98, define bool, false, true as a GNU extension. */
2828#define bool bool
2929#define false false
lib/include/stddef.h+8-1
......@@ -97,8 +97,15 @@ using ::std::nullptr_t;
9797#undef __need_NULL
9898#endif /* defined(__need_NULL) */
9999
100/* FIXME: This is using the placeholder dates Clang produces for these macros
101 in C2x mode; switch to the correct values once they've been published. */
102#if defined(__STDC_VERSION__) && __STDC_VERSION__ >= 202000L
103typedef typeof(nullptr) nullptr_t;
104#endif /* defined(__STDC_VERSION__) && __STDC_VERSION__ >= 202000L */
105
100106#if defined(__need_STDDEF_H_misc)
101#if __STDC_VERSION__ >= 201112L || __cplusplus >= 201103L
107#if (defined(__STDC_VERSION__) && __STDC_VERSION__ >= 201112L) || \
108 (defined(__cplusplus) && __cplusplus >= 201103L)
102109#include "__stddef_max_align_t.h"
103110#endif
104111#define offsetof(t, d) __builtin_offsetof(t, d)
lib/include/stdint.h+158-40
......@@ -96,13 +96,21 @@
9696typedef __INT64_TYPE__ int64_t;
9797# endif /* __int8_t_defined */
9898typedef __UINT64_TYPE__ uint64_t;
99# undef __int_least64_t
99100# define __int_least64_t int64_t
101# undef __uint_least64_t
100102# define __uint_least64_t uint64_t
103# undef __int_least32_t
101104# define __int_least32_t int64_t
105# undef __uint_least32_t
102106# define __uint_least32_t uint64_t
107# undef __int_least16_t
103108# define __int_least16_t int64_t
109# undef __uint_least16_t
104110# define __uint_least16_t uint64_t
111# undef __int_least8_t
105112# define __int_least8_t int64_t
113# undef __uint_least8_t
106114# define __uint_least8_t uint64_t
107115#endif /* __INT64_TYPE__ */
108116
......@@ -120,11 +128,17 @@ typedef int56_t int_least56_t;
120128typedef uint56_t uint_least56_t;
121129typedef int56_t int_fast56_t;
122130typedef uint56_t uint_fast56_t;
131# undef __int_least32_t
123132# define __int_least32_t int56_t
133# undef __uint_least32_t
124134# define __uint_least32_t uint56_t
135# undef __int_least16_t
125136# define __int_least16_t int56_t
137# undef __uint_least16_t
126138# define __uint_least16_t uint56_t
139# undef __int_least8_t
127140# define __int_least8_t int56_t
141# undef __uint_least8_t
128142# define __uint_least8_t uint56_t
129143#endif /* __INT56_TYPE__ */
130144
......@@ -136,11 +150,17 @@ typedef int48_t int_least48_t;
136150typedef uint48_t uint_least48_t;
137151typedef int48_t int_fast48_t;
138152typedef uint48_t uint_fast48_t;
153# undef __int_least32_t
139154# define __int_least32_t int48_t
155# undef __uint_least32_t
140156# define __uint_least32_t uint48_t
157# undef __int_least16_t
141158# define __int_least16_t int48_t
159# undef __uint_least16_t
142160# define __uint_least16_t uint48_t
161# undef __int_least8_t
143162# define __int_least8_t int48_t
163# undef __uint_least8_t
144164# define __uint_least8_t uint48_t
145165#endif /* __INT48_TYPE__ */
146166
......@@ -152,11 +172,17 @@ typedef int40_t int_least40_t;
152172typedef uint40_t uint_least40_t;
153173typedef int40_t int_fast40_t;
154174typedef uint40_t uint_fast40_t;
175# undef __int_least32_t
155176# define __int_least32_t int40_t
177# undef __uint_least32_t
156178# define __uint_least32_t uint40_t
179# undef __int_least16_t
157180# define __int_least16_t int40_t
181# undef __uint_least16_t
158182# define __uint_least16_t uint40_t
183# undef __int_least8_t
159184# define __int_least8_t int40_t
185# undef __uint_least8_t
160186# define __uint_least8_t uint40_t
161187#endif /* __INT40_TYPE__ */
162188
......@@ -172,11 +198,17 @@ typedef __INT32_TYPE__ int32_t;
172198typedef __UINT32_TYPE__ uint32_t;
173199# endif /* __uint32_t_defined */
174200
201# undef __int_least32_t
175202# define __int_least32_t int32_t
203# undef __uint_least32_t
176204# define __uint_least32_t uint32_t
205# undef __int_least16_t
177206# define __int_least16_t int32_t
207# undef __uint_least16_t
178208# define __uint_least16_t uint32_t
209# undef __int_least8_t
179210# define __int_least8_t int32_t
211# undef __uint_least8_t
180212# define __uint_least8_t uint32_t
181213#endif /* __INT32_TYPE__ */
182214
......@@ -194,9 +226,13 @@ typedef int24_t int_least24_t;
194226typedef uint24_t uint_least24_t;
195227typedef int24_t int_fast24_t;
196228typedef uint24_t uint_fast24_t;
229# undef __int_least16_t
197230# define __int_least16_t int24_t
231# undef __uint_least16_t
198232# define __uint_least16_t uint24_t
233# undef __int_least8_t
199234# define __int_least8_t int24_t
235# undef __uint_least8_t
200236# define __uint_least8_t uint24_t
201237#endif /* __INT24_TYPE__ */
202238
......@@ -205,9 +241,13 @@ typedef uint24_t uint_fast24_t;
205241typedef __INT16_TYPE__ int16_t;
206242#endif /* __int8_t_defined */
207243typedef __UINT16_TYPE__ uint16_t;
244# undef __int_least16_t
208245# define __int_least16_t int16_t
246# undef __uint_least16_t
209247# define __uint_least16_t uint16_t
248# undef __int_least8_t
210249# define __int_least8_t int16_t
250# undef __uint_least8_t
211251# define __uint_least8_t uint16_t
212252#endif /* __INT16_TYPE__ */
213253
......@@ -224,7 +264,9 @@ typedef __uint_least16_t uint_fast16_t;
224264typedef __INT8_TYPE__ int8_t;
225265#endif /* __int8_t_defined */
226266typedef __UINT8_TYPE__ uint8_t;
267# undef __int_least8_t
227268# define __int_least8_t int8_t
269# undef __uint_least8_t
228270# define __uint_least8_t uint8_t
229271#endif /* __INT8_TYPE__ */
230272
......@@ -285,16 +327,15 @@ typedef __UINTMAX_TYPE__ uintmax_t;
285327
286328
287329#ifdef __INT64_TYPE__
330# undef __int64_c_suffix
331# undef __int32_c_suffix
332# undef __int16_c_suffix
333# undef __int8_c_suffix
288334# ifdef __INT64_C_SUFFIX__
289335# define __int64_c_suffix __INT64_C_SUFFIX__
290336# define __int32_c_suffix __INT64_C_SUFFIX__
291337# define __int16_c_suffix __INT64_C_SUFFIX__
292338# define __int8_c_suffix __INT64_C_SUFFIX__
293# else
294# undef __int64_c_suffix
295# undef __int32_c_suffix
296# undef __int16_c_suffix
297# undef __int8_c_suffix
298339# endif /* __INT64_C_SUFFIX__ */
299340#endif /* __INT64_TYPE__ */
300341
......@@ -310,6 +351,9 @@ typedef __UINTMAX_TYPE__ uintmax_t;
310351
311352
312353#ifdef __INT56_TYPE__
354# undef __int32_c_suffix
355# undef __int16_c_suffix
356# undef __int8_c_suffix
313357# ifdef __INT56_C_SUFFIX__
314358# define INT56_C(v) __int_c(v, __INT56_C_SUFFIX__)
315359# define UINT56_C(v) __uint_c(v, __INT56_C_SUFFIX__)
......@@ -319,14 +363,14 @@ typedef __UINTMAX_TYPE__ uintmax_t;
319363# else
320364# define INT56_C(v) v
321365# define UINT56_C(v) v ## U
322# undef __int32_c_suffix
323# undef __int16_c_suffix
324# undef __int8_c_suffix
325366# endif /* __INT56_C_SUFFIX__ */
326367#endif /* __INT56_TYPE__ */
327368
328369
329370#ifdef __INT48_TYPE__
371# undef __int32_c_suffix
372# undef __int16_c_suffix
373# undef __int8_c_suffix
330374# ifdef __INT48_C_SUFFIX__
331375# define INT48_C(v) __int_c(v, __INT48_C_SUFFIX__)
332376# define UINT48_C(v) __uint_c(v, __INT48_C_SUFFIX__)
......@@ -336,14 +380,14 @@ typedef __UINTMAX_TYPE__ uintmax_t;
336380# else
337381# define INT48_C(v) v
338382# define UINT48_C(v) v ## U
339# undef __int32_c_suffix
340# undef __int16_c_suffix
341# undef __int8_c_suffix
342383# endif /* __INT48_C_SUFFIX__ */
343384#endif /* __INT48_TYPE__ */
344385
345386
346387#ifdef __INT40_TYPE__
388# undef __int32_c_suffix
389# undef __int16_c_suffix
390# undef __int8_c_suffix
347391# ifdef __INT40_C_SUFFIX__
348392# define INT40_C(v) __int_c(v, __INT40_C_SUFFIX__)
349393# define UINT40_C(v) __uint_c(v, __INT40_C_SUFFIX__)
......@@ -353,22 +397,18 @@ typedef __UINTMAX_TYPE__ uintmax_t;
353397# else
354398# define INT40_C(v) v
355399# define UINT40_C(v) v ## U
356# undef __int32_c_suffix
357# undef __int16_c_suffix
358# undef __int8_c_suffix
359400# endif /* __INT40_C_SUFFIX__ */
360401#endif /* __INT40_TYPE__ */
361402
362403
363404#ifdef __INT32_TYPE__
405# undef __int32_c_suffix
406# undef __int16_c_suffix
407# undef __int8_c_suffix
364408# ifdef __INT32_C_SUFFIX__
365409# define __int32_c_suffix __INT32_C_SUFFIX__
366410# define __int16_c_suffix __INT32_C_SUFFIX__
367411# define __int8_c_suffix __INT32_C_SUFFIX__
368#else
369# undef __int32_c_suffix
370# undef __int16_c_suffix
371# undef __int8_c_suffix
372412# endif /* __INT32_C_SUFFIX__ */
373413#endif /* __INT32_TYPE__ */
374414
......@@ -384,6 +424,8 @@ typedef __UINTMAX_TYPE__ uintmax_t;
384424
385425
386426#ifdef __INT24_TYPE__
427# undef __int16_c_suffix
428# undef __int8_c_suffix
387429# ifdef __INT24_C_SUFFIX__
388430# define INT24_C(v) __int_c(v, __INT24_C_SUFFIX__)
389431# define UINT24_C(v) __uint_c(v, __INT24_C_SUFFIX__)
......@@ -392,19 +434,16 @@ typedef __UINTMAX_TYPE__ uintmax_t;
392434# else
393435# define INT24_C(v) v
394436# define UINT24_C(v) v ## U
395# undef __int16_c_suffix
396# undef __int8_c_suffix
397437# endif /* __INT24_C_SUFFIX__ */
398438#endif /* __INT24_TYPE__ */
399439
400440
401441#ifdef __INT16_TYPE__
442# undef __int16_c_suffix
443# undef __int8_c_suffix
402444# ifdef __INT16_C_SUFFIX__
403445# define __int16_c_suffix __INT16_C_SUFFIX__
404446# define __int8_c_suffix __INT16_C_SUFFIX__
405#else
406# undef __int16_c_suffix
407# undef __int8_c_suffix
408447# endif /* __INT16_C_SUFFIX__ */
409448#endif /* __INT16_TYPE__ */
410449
......@@ -420,10 +459,9 @@ typedef __UINTMAX_TYPE__ uintmax_t;
420459
421460
422461#ifdef __INT8_TYPE__
462# undef __int8_c_suffix
423463# ifdef __INT8_C_SUFFIX__
424464# define __int8_c_suffix __INT8_C_SUFFIX__
425#else
426# undef __int8_c_suffix
427465# endif /* __INT8_C_SUFFIX__ */
428466#endif /* __INT8_TYPE__ */
429467
......@@ -463,27 +501,39 @@ typedef __UINTMAX_TYPE__ uintmax_t;
463501# define UINT64_MAX UINT64_C(18446744073709551615)
464502/* FIXME: This is using the placeholder dates Clang produces for these macros
465503 in C2x mode; switch to the correct values once they've been published. */
466#if __STDC_VERSION__ >= 202000L
504#if defined(__STDC_VERSION__) && __STDC_VERSION__ >= 202000L
467505# define UINT64_WIDTH 64
468506# define INT64_WIDTH UINT64_WIDTH
469507
470508# define __UINT_LEAST64_WIDTH UINT64_WIDTH
509# undef __UINT_LEAST32_WIDTH
471510# define __UINT_LEAST32_WIDTH UINT64_WIDTH
511# undef __UINT_LEAST16_WIDTH
472512# define __UINT_LEAST16_WIDTH UINT64_WIDTH
513# undef __UINT_LEAST8_MAX
473514# define __UINT_LEAST8_MAX UINT64_MAX
474515#endif /* __STDC_VERSION__ */
475516
476517# define __INT_LEAST64_MIN INT64_MIN
477518# define __INT_LEAST64_MAX INT64_MAX
478519# define __UINT_LEAST64_MAX UINT64_MAX
520# undef __INT_LEAST32_MIN
479521# define __INT_LEAST32_MIN INT64_MIN
522# undef __INT_LEAST32_MAX
480523# define __INT_LEAST32_MAX INT64_MAX
524# undef __UINT_LEAST32_MAX
481525# define __UINT_LEAST32_MAX UINT64_MAX
526# undef __INT_LEAST16_MIN
482527# define __INT_LEAST16_MIN INT64_MIN
528# undef __INT_LEAST16_MAX
483529# define __INT_LEAST16_MAX INT64_MAX
530# undef __UINT_LEAST16_MAX
484531# define __UINT_LEAST16_MAX UINT64_MAX
532# undef __INT_LEAST8_MIN
485533# define __INT_LEAST8_MIN INT64_MIN
534# undef __INT_LEAST8_MAX
486535# define __INT_LEAST8_MAX INT64_MAX
536# undef __UINT_LEAST8_MAX
487537# define __UINT_LEAST8_MAX UINT64_MAX
488538#endif /* __INT64_TYPE__ */
489539
......@@ -497,7 +547,7 @@ typedef __UINTMAX_TYPE__ uintmax_t;
497547
498548/* FIXME: This is using the placeholder dates Clang produces for these macros
499549 in C2x mode; switch to the correct values once they've been published. */
500#if __STDC_VERSION__ >= 202000L
550#if defined(__STDC_VERSION__) && __STDC_VERSION__ >= 202000L
501551# define UINT_LEAST64_WIDTH __UINT_LEAST64_WIDTH
502552# define INT_LEAST64_WIDTH UINT_LEAST64_WIDTH
503553# define UINT_FAST64_WIDTH __UINT_LEAST64_WIDTH
......@@ -517,27 +567,39 @@ typedef __UINTMAX_TYPE__ uintmax_t;
517567# define INT_FAST56_MAX INT56_MAX
518568# define UINT_FAST56_MAX UINT56_MAX
519569
570# undef __INT_LEAST32_MIN
520571# define __INT_LEAST32_MIN INT56_MIN
572# undef __INT_LEAST32_MAX
521573# define __INT_LEAST32_MAX INT56_MAX
574# undef __UINT_LEAST32_MAX
522575# define __UINT_LEAST32_MAX UINT56_MAX
576# undef __INT_LEAST16_MIN
523577# define __INT_LEAST16_MIN INT56_MIN
578# undef __INT_LEAST16_MAX
524579# define __INT_LEAST16_MAX INT56_MAX
580# undef __UINT_LEAST16_MAX
525581# define __UINT_LEAST16_MAX UINT56_MAX
582# undef __INT_LEAST8_MIN
526583# define __INT_LEAST8_MIN INT56_MIN
584# undef __INT_LEAST8_MAX
527585# define __INT_LEAST8_MAX INT56_MAX
586# undef __UINT_LEAST8_MAX
528587# define __UINT_LEAST8_MAX UINT56_MAX
529588
530589/* FIXME: This is using the placeholder dates Clang produces for these macros
531590 in C2x mode; switch to the correct values once they've been published. */
532#if __STDC_VERSION__ >= 202000L
591#if defined(__STDC_VERSION__) && __STDC_VERSION__ >= 202000L
533592# define UINT56_WIDTH 56
534593# define INT56_WIDTH UINT56_WIDTH
535594# define UINT_LEAST56_WIDTH UINT56_WIDTH
536595# define INT_LEAST56_WIDTH UINT_LEAST56_WIDTH
537596# define UINT_FAST56_WIDTH UINT56_WIDTH
538597# define INT_FAST56_WIDTH UINT_FAST56_WIDTH
598# undef __UINT_LEAST32_WIDTH
539599# define __UINT_LEAST32_WIDTH UINT56_WIDTH
600# undef __UINT_LEAST16_WIDTH
540601# define __UINT_LEAST16_WIDTH UINT56_WIDTH
602# undef __UINT_LEAST8_WIDTH
541603# define __UINT_LEAST8_WIDTH UINT56_WIDTH
542604#endif /* __STDC_VERSION__ */
543605#endif /* __INT56_TYPE__ */
......@@ -554,27 +616,39 @@ typedef __UINTMAX_TYPE__ uintmax_t;
554616# define INT_FAST48_MAX INT48_MAX
555617# define UINT_FAST48_MAX UINT48_MAX
556618
619# undef __INT_LEAST32_MIN
557620# define __INT_LEAST32_MIN INT48_MIN
621# undef __INT_LEAST32_MAX
558622# define __INT_LEAST32_MAX INT48_MAX
623# undef __UINT_LEAST32_MAX
559624# define __UINT_LEAST32_MAX UINT48_MAX
625# undef __INT_LEAST16_MIN
560626# define __INT_LEAST16_MIN INT48_MIN
627# undef __INT_LEAST16_MAX
561628# define __INT_LEAST16_MAX INT48_MAX
629# undef __UINT_LEAST16_MAX
562630# define __UINT_LEAST16_MAX UINT48_MAX
631# undef __INT_LEAST8_MIN
563632# define __INT_LEAST8_MIN INT48_MIN
633# undef __INT_LEAST8_MAX
564634# define __INT_LEAST8_MAX INT48_MAX
635# undef __UINT_LEAST8_MAX
565636# define __UINT_LEAST8_MAX UINT48_MAX
566637
567638/* FIXME: This is using the placeholder dates Clang produces for these macros
568639 in C2x mode; switch to the correct values once they've been published. */
569#if __STDC_VERSION__ >= 202000L
640#if defined(__STDC_VERSION__) && __STDC_VERSION__ >= 202000L
570641#define UINT48_WIDTH 48
571642#define INT48_WIDTH UINT48_WIDTH
572643#define UINT_LEAST48_WIDTH UINT48_WIDTH
573644#define INT_LEAST48_WIDTH UINT_LEAST48_WIDTH
574645#define UINT_FAST48_WIDTH UINT48_WIDTH
575646#define INT_FAST48_WIDTH UINT_FAST48_WIDTH
647#undef __UINT_LEAST32_WIDTH
576648#define __UINT_LEAST32_WIDTH UINT48_WIDTH
649# undef __UINT_LEAST16_WIDTH
577650#define __UINT_LEAST16_WIDTH UINT48_WIDTH
651# undef __UINT_LEAST8_WIDTH
578652#define __UINT_LEAST8_WIDTH UINT48_WIDTH
579653#endif /* __STDC_VERSION__ */
580654#endif /* __INT48_TYPE__ */
......@@ -591,27 +665,39 @@ typedef __UINTMAX_TYPE__ uintmax_t;
591665# define INT_FAST40_MAX INT40_MAX
592666# define UINT_FAST40_MAX UINT40_MAX
593667
668# undef __INT_LEAST32_MIN
594669# define __INT_LEAST32_MIN INT40_MIN
670# undef __INT_LEAST32_MAX
595671# define __INT_LEAST32_MAX INT40_MAX
672# undef __UINT_LEAST32_MAX
596673# define __UINT_LEAST32_MAX UINT40_MAX
674# undef __INT_LEAST16_MIN
597675# define __INT_LEAST16_MIN INT40_MIN
676# undef __INT_LEAST16_MAX
598677# define __INT_LEAST16_MAX INT40_MAX
678# undef __UINT_LEAST16_MAX
599679# define __UINT_LEAST16_MAX UINT40_MAX
680# undef __INT_LEAST8_MIN
600681# define __INT_LEAST8_MIN INT40_MIN
682# undef __INT_LEAST8_MAX
601683# define __INT_LEAST8_MAX INT40_MAX
684# undef __UINT_LEAST8_MAX
602685# define __UINT_LEAST8_MAX UINT40_MAX
603686
604687/* FIXME: This is using the placeholder dates Clang produces for these macros
605688 in C2x mode; switch to the correct values once they've been published. */
606#if __STDC_VERSION__ >= 202000L
689#if defined(__STDC_VERSION__) && __STDC_VERSION__ >= 202000L
607690# define UINT40_WIDTH 40
608691# define INT40_WIDTH UINT40_WIDTH
609692# define UINT_LEAST40_WIDTH UINT40_WIDTH
610693# define INT_LEAST40_WIDTH UINT_LEAST40_WIDTH
611694# define UINT_FAST40_WIDTH UINT40_WIDTH
612695# define INT_FAST40_WIDTH UINT_FAST40_WIDTH
696# undef __UINT_LEAST32_WIDTH
613697# define __UINT_LEAST32_WIDTH UINT40_WIDTH
698# undef __UINT_LEAST16_WIDTH
614699# define __UINT_LEAST16_WIDTH UINT40_WIDTH
700# undef __UINT_LEAST8_WIDTH
615701# define __UINT_LEAST8_WIDTH UINT40_WIDTH
616702#endif /* __STDC_VERSION__ */
617703#endif /* __INT40_TYPE__ */
......@@ -622,23 +708,35 @@ typedef __UINTMAX_TYPE__ uintmax_t;
622708# define INT32_MIN (-INT32_C(2147483647)-1)
623709# define UINT32_MAX UINT32_C(4294967295)
624710
711# undef __INT_LEAST32_MIN
625712# define __INT_LEAST32_MIN INT32_MIN
713# undef __INT_LEAST32_MAX
626714# define __INT_LEAST32_MAX INT32_MAX
715# undef __UINT_LEAST32_MAX
627716# define __UINT_LEAST32_MAX UINT32_MAX
717# undef __INT_LEAST16_MIN
628718# define __INT_LEAST16_MIN INT32_MIN
719# undef __INT_LEAST16_MAX
629720# define __INT_LEAST16_MAX INT32_MAX
721# undef __UINT_LEAST16_MAX
630722# define __UINT_LEAST16_MAX UINT32_MAX
723# undef __INT_LEAST8_MIN
631724# define __INT_LEAST8_MIN INT32_MIN
725# undef __INT_LEAST8_MAX
632726# define __INT_LEAST8_MAX INT32_MAX
727# undef __UINT_LEAST8_MAX
633728# define __UINT_LEAST8_MAX UINT32_MAX
634729
635730/* FIXME: This is using the placeholder dates Clang produces for these macros
636731 in C2x mode; switch to the correct values once they've been published. */
637#if __STDC_VERSION__ >= 202000L
732#if defined(__STDC_VERSION__) && __STDC_VERSION__ >= 202000L
638733# define UINT32_WIDTH 32
639734# define INT32_WIDTH UINT32_WIDTH
735# undef __UINT_LEAST32_WIDTH
640736# define __UINT_LEAST32_WIDTH UINT32_WIDTH
737# undef __UINT_LEAST16_WIDTH
641738# define __UINT_LEAST16_WIDTH UINT32_WIDTH
739# undef __UINT_LEAST8_WIDTH
642740# define __UINT_LEAST8_WIDTH UINT32_WIDTH
643741#endif /* __STDC_VERSION__ */
644742#endif /* __INT32_TYPE__ */
......@@ -653,7 +751,7 @@ typedef __UINTMAX_TYPE__ uintmax_t;
653751
654752/* FIXME: This is using the placeholder dates Clang produces for these macros
655753 in C2x mode; switch to the correct values once they've been published. */
656#if __STDC_VERSION__ >= 202000L
754#if defined(__STDC_VERSION__) && __STDC_VERSION__ >= 202000L
657755# define UINT_LEAST32_WIDTH __UINT_LEAST32_WIDTH
658756# define INT_LEAST32_WIDTH UINT_LEAST32_WIDTH
659757# define UINT_FAST32_WIDTH __UINT_LEAST32_WIDTH
......@@ -673,23 +771,31 @@ typedef __UINTMAX_TYPE__ uintmax_t;
673771# define INT_FAST24_MAX INT24_MAX
674772# define UINT_FAST24_MAX UINT24_MAX
675773
774# undef __INT_LEAST16_MIN
676775# define __INT_LEAST16_MIN INT24_MIN
776# undef __INT_LEAST16_MAX
677777# define __INT_LEAST16_MAX INT24_MAX
778# undef __UINT_LEAST16_MAX
678779# define __UINT_LEAST16_MAX UINT24_MAX
780# undef __INT_LEAST8_MIN
679781# define __INT_LEAST8_MIN INT24_MIN
782# undef __INT_LEAST8_MAX
680783# define __INT_LEAST8_MAX INT24_MAX
784# undef __UINT_LEAST8_MAX
681785# define __UINT_LEAST8_MAX UINT24_MAX
682786
683787/* FIXME: This is using the placeholder dates Clang produces for these macros
684788 in C2x mode; switch to the correct values once they've been published. */
685#if __STDC_VERSION__ >= 202000L
789#if defined(__STDC_VERSION__) && __STDC_VERSION__ >= 202000L
686790# define UINT24_WIDTH 24
687791# define INT24_WIDTH UINT24_WIDTH
688792# define UINT_LEAST24_WIDTH UINT24_WIDTH
689793# define INT_LEAST24_WIDTH UINT_LEAST24_WIDTH
690794# define UINT_FAST24_WIDTH UINT24_WIDTH
691795# define INT_FAST24_WIDTH UINT_FAST24_WIDTH
796# undef __UINT_LEAST16_WIDTH
692797# define __UINT_LEAST16_WIDTH UINT24_WIDTH
798# undef __UINT_LEAST8_WIDTH
693799# define __UINT_LEAST8_WIDTH UINT24_WIDTH
694800#endif /* __STDC_VERSION__ */
695801#endif /* __INT24_TYPE__ */
......@@ -700,19 +806,27 @@ typedef __UINTMAX_TYPE__ uintmax_t;
700806#define INT16_MIN (-INT16_C(32767)-1)
701807#define UINT16_MAX UINT16_C(65535)
702808
809# undef __INT_LEAST16_MIN
703810# define __INT_LEAST16_MIN INT16_MIN
811# undef __INT_LEAST16_MAX
704812# define __INT_LEAST16_MAX INT16_MAX
813# undef __UINT_LEAST16_MAX
705814# define __UINT_LEAST16_MAX UINT16_MAX
815# undef __INT_LEAST8_MIN
706816# define __INT_LEAST8_MIN INT16_MIN
817# undef __INT_LEAST8_MAX
707818# define __INT_LEAST8_MAX INT16_MAX
819# undef __UINT_LEAST8_MAX
708820# define __UINT_LEAST8_MAX UINT16_MAX
709821
710822/* FIXME: This is using the placeholder dates Clang produces for these macros
711823 in C2x mode; switch to the correct values once they've been published. */
712#if __STDC_VERSION__ >= 202000L
824#if defined(__STDC_VERSION__) && __STDC_VERSION__ >= 202000L
713825# define UINT16_WIDTH 16
714826# define INT16_WIDTH UINT16_WIDTH
827# undef __UINT_LEAST16_WIDTH
715828# define __UINT_LEAST16_WIDTH UINT16_WIDTH
829# undef __UINT_LEAST8_WIDTH
716830# define __UINT_LEAST8_WIDTH UINT16_WIDTH
717831#endif /* __STDC_VERSION__ */
718832#endif /* __INT16_TYPE__ */
......@@ -727,7 +841,7 @@ typedef __UINTMAX_TYPE__ uintmax_t;
727841
728842/* FIXME: This is using the placeholder dates Clang produces for these macros
729843 in C2x mode; switch to the correct values once they've been published. */
730#if __STDC_VERSION__ >= 202000L
844#if defined(__STDC_VERSION__) && __STDC_VERSION__ >= 202000L
731845# define UINT_LEAST16_WIDTH __UINT_LEAST16_WIDTH
732846# define INT_LEAST16_WIDTH UINT_LEAST16_WIDTH
733847# define UINT_FAST16_WIDTH __UINT_LEAST16_WIDTH
......@@ -741,15 +855,19 @@ typedef __UINTMAX_TYPE__ uintmax_t;
741855# define INT8_MIN (-INT8_C(127)-1)
742856# define UINT8_MAX UINT8_C(255)
743857
858# undef __INT_LEAST8_MIN
744859# define __INT_LEAST8_MIN INT8_MIN
860# undef __INT_LEAST8_MAX
745861# define __INT_LEAST8_MAX INT8_MAX
862# undef __UINT_LEAST8_MAX
746863# define __UINT_LEAST8_MAX UINT8_MAX
747864
748865/* FIXME: This is using the placeholder dates Clang produces for these macros
749866 in C2x mode; switch to the correct values once they've been published. */
750#if __STDC_VERSION__ >= 202000L
867#if defined(__STDC_VERSION__) && __STDC_VERSION__ >= 202000L
751868# define UINT8_WIDTH 8
752869# define INT8_WIDTH UINT8_WIDTH
870# undef __UINT_LEAST8_WIDTH
753871# define __UINT_LEAST8_WIDTH UINT8_WIDTH
754872#endif /* __STDC_VERSION__ */
755873#endif /* __INT8_TYPE__ */
......@@ -764,7 +882,7 @@ typedef __UINTMAX_TYPE__ uintmax_t;
764882
765883/* FIXME: This is using the placeholder dates Clang produces for these macros
766884 in C2x mode; switch to the correct values once they've been published. */
767#if __STDC_VERSION__ >= 202000L
885#if defined(__STDC_VERSION__) && __STDC_VERSION__ >= 202000L
768886# define UINT_LEAST8_WIDTH __UINT_LEAST8_WIDTH
769887# define INT_LEAST8_WIDTH UINT_LEAST8_WIDTH
770888# define UINT_FAST8_WIDTH __UINT_LEAST8_WIDTH
......@@ -792,7 +910,7 @@ typedef __UINTMAX_TYPE__ uintmax_t;
792910/* C2x 7.20.2.4 Width of integer types capable of holding object pointers. */
793911/* FIXME: This is using the placeholder dates Clang produces for these macros
794912 in C2x mode; switch to the correct values once they've been published. */
795#if __STDC_VERSION__ >= 202000L
913#if defined(__STDC_VERSION__) && __STDC_VERSION__ >= 202000L
796914/* NB: The C standard requires that these be the same value, but the compiler
797915 exposes separate internal width macros. */
798916#define INTPTR_WIDTH __INTPTR_WIDTH__
......@@ -813,7 +931,7 @@ typedef __UINTMAX_TYPE__ uintmax_t;
813931/* C2x 7.20.2.5 Width of greatest-width integer types. */
814932/* FIXME: This is using the placeholder dates Clang produces for these macros
815933 in C2x mode; switch to the correct values once they've been published. */
816#if __STDC_VERSION__ >= 202000L
934#if defined(__STDC_VERSION__) && __STDC_VERSION__ >= 202000L
817935/* NB: The C standard requires that these be the same value, but the compiler
818936 exposes separate internal width macros. */
819937#define INTMAX_WIDTH __INTMAX_WIDTH__
......@@ -849,7 +967,7 @@ typedef __UINTMAX_TYPE__ uintmax_t;
849967/* C2x 7.20.3.x Width of other integer types. */
850968/* FIXME: This is using the placeholder dates Clang produces for these macros
851969 in C2x mode; switch to the correct values once they've been published. */
852#if __STDC_VERSION__ >= 202000L
970#if defined(__STDC_VERSION__) && __STDC_VERSION__ >= 202000L
853971#define PTRDIFF_WIDTH __PTRDIFF_WIDTH__
854972#define SIG_ATOMIC_WIDTH __SIG_ATOMIC_WIDTH__
855973#define SIZE_WIDTH __SIZE_WIDTH__
lib/include/stdnoreturn.h+1-1
......@@ -13,7 +13,7 @@
1313#define noreturn _Noreturn
1414#define __noreturn_is_defined 1
1515
16#if __STDC_VERSION__ > 201710L && \
16#if (defined(__STDC_VERSION__) && __STDC_VERSION__ > 201710L) && \
1717 !defined(_CLANG_DISABLE_CRT_DEPRECATION_WARNINGS)
1818/* The noreturn macro is deprecated in C2x. We do not mark it as such because
1919 including the header file in C2x is also deprecated and we do not want to
lib/include/unwind.h+2-1
......@@ -65,7 +65,8 @@ struct _Unwind_Context;
6565#if defined(__arm__) && !(defined(__USING_SJLJ_EXCEPTIONS__) || \
6666 defined(__ARM_DWARF_EH__) || defined(__SEH__))
6767struct _Unwind_Control_Block;
68typedef struct _Unwind_Control_Block _Unwind_Exception; /* Alias */
68typedef struct _Unwind_Control_Block _Unwind_Control_Block;
69#define _Unwind_Exception _Unwind_Control_Block /* Alias */
6970#else
7071struct _Unwind_Exception;
7172typedef struct _Unwind_Exception _Unwind_Exception;
lib/include/velintrin.h+1-1
......@@ -13,7 +13,7 @@
1313typedef double __vr __attribute__((__vector_size__(2048)));
1414
1515// Vector mask registers
16#if __STDC_VERSION__ >= 199901L
16#if defined(__STDC_VERSION__) && __STDC_VERSION__ >= 199901L
1717// For C99
1818typedef _Bool __vm __attribute__((ext_vector_type(256)));
1919typedef _Bool __vm256 __attribute__((ext_vector_type(256)));
lib/include/x86gprintrin.h+19-7
......@@ -25,23 +25,35 @@
2525#include <crc32intrin.h>
2626#endif
2727
28#if !(defined(_MSC_VER) || defined(__SCE__)) || __has_feature(modules) || \
29 defined(__PRFCHI__)
30#include <prfchiintrin.h>
31#endif
32
33#if !(defined(_MSC_VER) || defined(__SCE__)) || __has_feature(modules) || \
34 defined(__RAOINT__)
35#include <raointintrin.h>
36#endif
37
38#if !(defined(_MSC_VER) || defined(__SCE__)) || __has_feature(modules) || \
39 defined(__CMPCCXADD__)
40#include <cmpccxaddintrin.h>
41#endif
42
2843#if defined(__i386__)
29#define __FULLBX "ebx"
44#define __SAVE_GPRBX "mov {%%ebx, %%eax |eax, ebx};"
45#define __RESTORE_GPRBX "mov {%%eax, %%ebx |ebx, eax};"
3046#define __TMPGPR "eax"
3147#else
3248// When in 64-bit target, the 32-bit operands generate a 32-bit result,
3349// zero-extended to a 64-bit result in the destination general-purpose,
3450// It means "mov x %ebx" will clobber the higher 32 bits of rbx, so we
3551// should preserve the 64-bit register rbx.
36#define __FULLBX "rbx"
52#define __SAVE_GPRBX "mov {%%rbx, %%rax |rax, rbx};"
53#define __RESTORE_GPRBX "mov {%%rax, %%rbx |rbx, rax};"
3754#define __TMPGPR "rax"
3855#endif
3956
40#define __MOVEGPR(__r1, __r2) "mov {%%"__r1 ", %%"__r2 "|"__r2 ", "__r1"};"
41
42#define __SAVE_GPRBX __MOVEGPR(__FULLBX, __TMPGPR)
43#define __RESTORE_GPRBX __MOVEGPR(__TMPGPR, __FULLBX)
44
4557#define __SSC_MARK(__Tag) \
4658 __asm__ __volatile__( __SAVE_GPRBX \
4759 "mov {%0, %%ebx|ebx, %0}; " \
lib/include/xmmintrin.h+1-2
......@@ -1906,7 +1906,7 @@ _mm_setr_ps(float __z, float __y, float __x, float __w)
19061906static __inline__ __m128 __DEFAULT_FN_ATTRS
19071907_mm_setzero_ps(void)
19081908{
1909 return __extension__ (__m128){ 0, 0, 0, 0 };
1909 return __extension__ (__m128){ 0.0f, 0.0f, 0.0f, 0.0f };
19101910}
19111911
19121912/// Stores the upper 64 bits of a 128-bit vector of [4 x float] to a
......@@ -3005,7 +3005,6 @@ do { \
30053005#define _m_pavgw _mm_avg_pu16
30063006#define _m_psadbw _mm_sad_pu8
30073007#define _m_ _mm_
3008#define _m_ _mm_
30093008
30103009#undef __DEFAULT_FN_ATTRS
30113010#undef __DEFAULT_FN_ATTRS_MMX