| #include "edge-impulse-sdk/dsp/config.hpp" |
| #if EIDSP_LOAD_CMSIS_DSP_SOURCES |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
|
|
| #include "edge-impulse-sdk/CMSIS/DSP/Include/dsp/complex_math_functions_f16.h" |
|
|
| #if defined(ARM_FLOAT16_SUPPORTED) |
| |
| |
| |
|
|
|
|
|
|
| |
| |
| |
| |
|
|
| |
| |
| |
| |
| |
| |
| |
|
|
| #if defined(ARM_MATH_MVE_FLOAT16) && !defined(ARM_MATH_AUTOVECTORIZE) |
|
|
| #include "edge-impulse-sdk/CMSIS/DSP/Include/arm_helium_utils.h" |
|
|
|
|
| void arm_cmplx_mag_f16( |
| const float16_t * pSrc, |
| float16_t * pDst, |
| uint32_t numSamples) |
| { |
| int32_t blockSize = numSamples; |
| uint32_t blkCnt; |
| f16x8x2_t vecSrc; |
| f16x8_t sum; |
|
|
| |
| blkCnt = blockSize >> 3; |
| while (blkCnt > 0U) |
| { |
| q15x8_t newtonStartVec; |
| f16x8_t sumHalf, invSqrt; |
|
|
| vecSrc = vld2q(pSrc); |
| pSrc += 16; |
| sum = vmulq(vecSrc.val[0], vecSrc.val[0]); |
| sum = vfmaq(sum, vecSrc.val[1], vecSrc.val[1]); |
|
|
| |
| |
| |
|
|
| |
| newtonStartVec = vdupq_n_s16(INVSQRT_MAGIC_F16) - vshrq((q15x8_t) sum, 1); |
| sumHalf = sum * 0.5f; |
| |
| |
| |
| |
| |
| |
| |
| INVSQRT_NEWTON_MVE_F16(invSqrt, sumHalf, (f16x8_t) newtonStartVec); |
| INVSQRT_NEWTON_MVE_F16(invSqrt, sumHalf, invSqrt); |
| INVSQRT_NEWTON_MVE_F16(invSqrt, sumHalf, invSqrt); |
| |
| |
| |
| invSqrt = vdupq_m(invSqrt, (float16_t)0.0f, vcmpltq(invSqrt, (float16_t)0.0f)); |
| |
| |
| |
| sum = vmulq(sum, invSqrt); |
| vstrhq_f16(pDst, sum); |
| pDst += 8; |
| |
| |
| |
| blkCnt--; |
| } |
| |
| |
| |
| blkCnt = blockSize & 7; |
| if (blkCnt > 0U) |
| { |
| mve_pred16_t p0 = vctp16q(blkCnt); |
| q15x8_t newtonStartVec; |
| f16x8_t sumHalf, invSqrt; |
|
|
| vecSrc = vld2q((float16_t const *)pSrc); |
| sum = vmulq(vecSrc.val[0], vecSrc.val[0]); |
| sum = vfmaq(sum, vecSrc.val[1], vecSrc.val[1]); |
|
|
| |
| |
| |
|
|
| |
| newtonStartVec = vdupq_n_s16(INVSQRT_MAGIC_F16) - vshrq((q15x8_t) sum, 1); |
| sumHalf = vmulq(sum, (float16_t)0.5); |
| |
| |
| |
| INVSQRT_NEWTON_MVE_F16(invSqrt, sumHalf, (f16x8_t) newtonStartVec); |
| INVSQRT_NEWTON_MVE_F16(invSqrt, sumHalf, invSqrt); |
| |
| |
| |
| invSqrt = vdupq_m(invSqrt, (float16_t)0.0, vcmpltq(invSqrt, (float16_t)0.0)); |
| |
| |
| |
| sum = vmulq(sum, invSqrt); |
| vstrhq_p_f16(pDst, sum, p0); |
| } |
| } |
|
|
| #else |
| void arm_cmplx_mag_f16( |
| const float16_t * pSrc, |
| float16_t * pDst, |
| uint32_t numSamples) |
| { |
| uint32_t blkCnt; |
| _Float16 real, imag; |
|
|
| #if defined (ARM_MATH_LOOPUNROLL) && !defined(ARM_MATH_AUTOVECTORIZE) |
|
|
| |
| blkCnt = numSamples >> 2U; |
|
|
| while (blkCnt > 0U) |
| { |
| |
|
|
| real = *pSrc++; |
| imag = *pSrc++; |
|
|
| |
| arm_sqrt_f16((real * real) + (imag * imag), pDst++); |
|
|
| real = *pSrc++; |
| imag = *pSrc++; |
| arm_sqrt_f16((real * real) + (imag * imag), pDst++); |
|
|
| real = *pSrc++; |
| imag = *pSrc++; |
| arm_sqrt_f16((real * real) + (imag * imag), pDst++); |
|
|
| real = *pSrc++; |
| imag = *pSrc++; |
| arm_sqrt_f16((real * real) + (imag * imag), pDst++); |
|
|
| |
| blkCnt--; |
| } |
|
|
| |
| blkCnt = numSamples % 0x4U; |
|
|
| #else |
|
|
| |
| blkCnt = numSamples; |
|
|
| #endif |
|
|
| while (blkCnt > 0U) |
| { |
| |
|
|
| real = *pSrc++; |
| imag = *pSrc++; |
|
|
| |
| arm_sqrt_f16((real * real) + (imag * imag), pDst++); |
|
|
| |
| blkCnt--; |
| } |
|
|
| } |
| #endif |
|
|
| |
| |
| |
|
|
| #endif |
|
|
| #endif |
|
|