| #include "edge-impulse-sdk/dsp/config.hpp" |
| #if EIDSP_LOAD_CMSIS_DSP_SOURCES |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
| |
|
|
| #include "edge-impulse-sdk/CMSIS/DSP/Include/dsp/transform_functions_f16.h" |
|
|
| #if defined(ARM_FLOAT16_SUPPORTED) |
|
|
| void arm_radix2_butterfly_f16( |
| float16_t * pSrc, |
| uint32_t fftLen, |
| const float16_t * pCoef, |
| uint16_t twidCoefModifier); |
|
|
| void arm_radix2_butterfly_inverse_f16( |
| float16_t * pSrc, |
| uint32_t fftLen, |
| const float16_t * pCoef, |
| uint16_t twidCoefModifier, |
| float16_t onebyfftLen); |
|
|
| extern void arm_bitreversal_f16( |
| float16_t * pSrc, |
| uint16_t fftSize, |
| uint16_t bitRevFactor, |
| const uint16_t * pBitRevTab); |
|
|
| |
| |
| |
|
|
| |
| |
| |
| |
|
|
| |
| |
| |
| |
| |
| |
| |
|
|
| void arm_cfft_radix2_f16( |
| const arm_cfft_radix2_instance_f16 * S, |
| float16_t * pSrc) |
| { |
|
|
| if (S->ifftFlag == 1U) |
| { |
| |
| arm_radix2_butterfly_inverse_f16(pSrc, S->fftLen, S->pTwiddle, |
| S->twidCoefModifier, S->onebyfftLen); |
| } |
| else |
| { |
| |
| arm_radix2_butterfly_f16(pSrc, S->fftLen, S->pTwiddle, |
| S->twidCoefModifier); |
| } |
|
|
| if (S->bitReverseFlag == 1U) |
| { |
| |
| arm_bitreversal_f16(pSrc, S->fftLen, S->bitRevFactor, S->pBitRevTable); |
| } |
|
|
| } |
|
|
|
|
| |
| |
| |
|
|
|
|
|
|
| |
| |
| |
|
|
| |
| |
| |
| |
| |
| |
| |
| |
|
|
| void arm_radix2_butterfly_f16( |
| float16_t * pSrc, |
| uint32_t fftLen, |
| const float16_t * pCoef, |
| uint16_t twidCoefModifier) |
| { |
|
|
| uint32_t i, j, k, l; |
| uint32_t n1, n2, ia; |
| float16_t xt, yt, cosVal, sinVal; |
| float16_t p0, p1, p2, p3; |
| float16_t a0, a1; |
|
|
| #if defined (ARM_MATH_DSP) |
|
|
| |
| n2 = fftLen >> 1; |
| ia = 0; |
| i = 0; |
|
|
| |
| for (k = n2; k > 0; k--) |
| { |
| cosVal = pCoef[ia * 2]; |
| sinVal = pCoef[(ia * 2) + 1]; |
|
|
| |
| ia += twidCoefModifier; |
|
|
| |
| |
| l = i + n2; |
|
|
| |
| a0 = (_Float16)pSrc[2 * i] + (_Float16)pSrc[2 * l]; |
| xt = (_Float16)pSrc[2 * i] - (_Float16)pSrc[2 * l]; |
|
|
| yt = (_Float16)pSrc[2 * i + 1] - (_Float16)pSrc[2 * l + 1]; |
| a1 = (_Float16)pSrc[2 * l + 1] + (_Float16)pSrc[2 * i + 1]; |
|
|
| p0 = (_Float16)xt * (_Float16)cosVal; |
| p1 = (_Float16)yt * (_Float16)sinVal; |
| p2 = (_Float16)yt * (_Float16)cosVal; |
| p3 = (_Float16)xt * (_Float16)sinVal; |
|
|
| pSrc[2 * i] = a0; |
| pSrc[2 * i + 1] = a1; |
|
|
| pSrc[2 * l] = (_Float16)p0 + (_Float16)p1; |
| pSrc[2 * l + 1] = (_Float16)p2 - (_Float16)p3; |
|
|
| i++; |
| } |
|
|
| twidCoefModifier <<= 1U; |
|
|
| |
| for (k = n2; k > 2; k = k >> 1) |
| { |
| n1 = n2; |
| n2 = n2 >> 1; |
| ia = 0; |
|
|
| |
| j = 0; |
| do |
| { |
| cosVal = pCoef[ia * 2]; |
| sinVal = pCoef[(ia * 2) + 1]; |
| ia += twidCoefModifier; |
|
|
| |
| i = j; |
| do |
| { |
| l = i + n2; |
| a0 = (_Float16)pSrc[2 * i] + (_Float16)pSrc[2 * l]; |
| xt = (_Float16)pSrc[2 * i] - (_Float16)pSrc[2 * l]; |
|
|
| yt = (_Float16)pSrc[2 * i + 1] - (_Float16)pSrc[2 * l + 1]; |
| a1 = (_Float16)pSrc[2 * l + 1] + (_Float16)pSrc[2 * i + 1]; |
|
|
| p0 = (_Float16)xt * (_Float16)cosVal; |
| p1 = (_Float16)yt * (_Float16)sinVal; |
| p2 = (_Float16)yt * (_Float16)cosVal; |
| p3 = (_Float16)xt * (_Float16)sinVal; |
|
|
| pSrc[2 * i] = a0; |
| pSrc[2 * i + 1] = a1; |
|
|
| pSrc[2 * l] = (_Float16)p0 + (_Float16)p1; |
| pSrc[2 * l + 1] = (_Float16)p2 - (_Float16)p3; |
|
|
| i += n1; |
| } while ( i < fftLen ); |
| j++; |
| } while ( j < n2); |
| twidCoefModifier <<= 1U; |
| } |
|
|
| |
| for (i = 0; i < fftLen; i += 2) |
| { |
| a0 = (_Float16)pSrc[2 * i] + (_Float16)pSrc[2 * i + 2]; |
| xt = (_Float16)pSrc[2 * i] - (_Float16)pSrc[2 * i + 2]; |
|
|
| yt = (_Float16)pSrc[2 * i + 1] - (_Float16)pSrc[2 * i + 3]; |
| a1 = (_Float16)pSrc[2 * i + 3] + (_Float16)pSrc[2 * i + 1]; |
|
|
| pSrc[2 * i] = a0; |
| pSrc[2 * i + 1] = a1; |
| pSrc[2 * i + 2] = xt; |
| pSrc[2 * i + 3] = yt; |
| } |
|
|
| #else |
|
|
| n2 = fftLen; |
|
|
| |
| for (k = fftLen; k > 1; k = k >> 1) |
| { |
| n1 = n2; |
| n2 = n2 >> 1; |
| ia = 0; |
|
|
| |
| j = 0; |
| do |
| { |
| cosVal = pCoef[ia * 2]; |
| sinVal = pCoef[(ia * 2) + 1]; |
| ia += twidCoefModifier; |
|
|
| |
| i = j; |
| do |
| { |
| l = i + n2; |
| a0 = (_Float16)pSrc[2 * i] + (_Float16)pSrc[2 * l]; |
| xt = (_Float16)pSrc[2 * i] - (_Float16)pSrc[2 * l]; |
|
|
| yt = (_Float16)pSrc[2 * i + 1] - (_Float16)pSrc[2 * l + 1]; |
| a1 = (_Float16)pSrc[2 * l + 1] + (_Float16)pSrc[2 * i + 1]; |
|
|
| p0 = (_Float16)xt * (_Float16)cosVal; |
| p1 = (_Float16)yt * (_Float16)sinVal; |
| p2 = (_Float16)yt * (_Float16)cosVal; |
| p3 = (_Float16)xt * (_Float16)sinVal; |
|
|
| pSrc[2 * i] = a0; |
| pSrc[2 * i + 1] = a1; |
|
|
| pSrc[2 * l] = (_Float16)p0 + (_Float16)p1; |
| pSrc[2 * l + 1] = (_Float16)p2 - (_Float16)p3; |
|
|
| i += n1; |
| } while (i < fftLen); |
| j++; |
| } while (j < n2); |
| twidCoefModifier <<= 1U; |
| } |
|
|
| #endif |
|
|
| } |
|
|
|
|
| void arm_radix2_butterfly_inverse_f16( |
| float16_t * pSrc, |
| uint32_t fftLen, |
| const float16_t * pCoef, |
| uint16_t twidCoefModifier, |
| float16_t onebyfftLen) |
| { |
|
|
| uint32_t i, j, k, l; |
| uint32_t n1, n2, ia; |
| float16_t xt, yt, cosVal, sinVal; |
| float16_t p0, p1, p2, p3; |
| float16_t a0, a1; |
|
|
| #if defined (ARM_MATH_DSP) |
|
|
| n2 = fftLen >> 1; |
| ia = 0; |
|
|
| |
| for (i = 0; i < n2; i++) |
| { |
| cosVal = pCoef[ia * 2]; |
| sinVal = pCoef[(ia * 2) + 1]; |
| ia += twidCoefModifier; |
|
|
| l = i + n2; |
| a0 = (_Float16)pSrc[2 * i] + (_Float16)pSrc[2 * l]; |
| xt = (_Float16)pSrc[2 * i] - (_Float16)pSrc[2 * l]; |
|
|
| yt = (_Float16)pSrc[2 * i + 1] - (_Float16)pSrc[2 * l + 1]; |
| a1 = (_Float16)pSrc[2 * l + 1] + (_Float16)pSrc[2 * i + 1]; |
|
|
| p0 = (_Float16)xt * (_Float16)cosVal; |
| p1 = (_Float16)yt * (_Float16)sinVal; |
| p2 = (_Float16)yt * (_Float16)cosVal; |
| p3 = (_Float16)xt * (_Float16)sinVal; |
|
|
| pSrc[2 * i] = a0; |
| pSrc[2 * i + 1] = a1; |
|
|
| pSrc[2 * l] = (_Float16)p0 - (_Float16)p1; |
| pSrc[2 * l + 1] = (_Float16)p2 + (_Float16)p3; |
| } |
|
|
| twidCoefModifier <<= 1U; |
|
|
| |
| for (k = fftLen / 2; k > 2; k = k >> 1) |
| { |
| n1 = n2; |
| n2 = n2 >> 1; |
| ia = 0; |
|
|
| |
| j = 0; |
| do |
| { |
| cosVal = pCoef[ia * 2]; |
| sinVal = pCoef[(ia * 2) + 1]; |
| ia += twidCoefModifier; |
|
|
| |
| i = j; |
| do |
| { |
| l = i + n2; |
| a0 = (_Float16)pSrc[2 * i] + (_Float16)pSrc[2 * l]; |
| xt = (_Float16)pSrc[2 * i] - (_Float16)pSrc[2 * l]; |
|
|
| yt = (_Float16)pSrc[2 * i + 1] - (_Float16)pSrc[2 * l + 1]; |
| a1 = (_Float16)pSrc[2 * l + 1] + (_Float16)pSrc[2 * i + 1]; |
|
|
| p0 = (_Float16)xt * (_Float16)cosVal; |
| p1 = (_Float16)yt * (_Float16)sinVal; |
| p2 = (_Float16)yt * (_Float16)cosVal; |
| p3 = (_Float16)xt * (_Float16)sinVal; |
|
|
| pSrc[2 * i] = a0; |
| pSrc[2 * i + 1] = a1; |
|
|
| pSrc[2 * l] = (_Float16)p0 - (_Float16)p1; |
| pSrc[2 * l + 1] = (_Float16)p2 + (_Float16)p3; |
|
|
| i += n1; |
| } while ( i < fftLen ); |
| j++; |
| } while (j < n2); |
|
|
| twidCoefModifier <<= 1U; |
| } |
|
|
| |
| for (i = 0; i < fftLen; i += 2) |
| { |
| a0 = (_Float16)pSrc[2 * i] + (_Float16)pSrc[2 * i + 2]; |
| xt = (_Float16)pSrc[2 * i] - (_Float16)pSrc[2 * i + 2]; |
|
|
| a1 = (_Float16)pSrc[2 * i + 3] + (_Float16)pSrc[2 * i + 1]; |
| yt = (_Float16)pSrc[2 * i + 1] - (_Float16)pSrc[2 * i + 3]; |
|
|
| p0 = (_Float16)a0 * (_Float16)onebyfftLen; |
| p2 = (_Float16)xt * (_Float16)onebyfftLen; |
| p1 = (_Float16)a1 * (_Float16)onebyfftLen; |
| p3 = (_Float16)yt * (_Float16)onebyfftLen; |
|
|
| pSrc[2 * i] = p0; |
| pSrc[2 * i + 1] = p1; |
| pSrc[2 * i + 2] = p2; |
| pSrc[2 * i + 3] = p3; |
| } |
|
|
| #else |
|
|
| n2 = fftLen; |
|
|
| |
| for (k = fftLen; k > 2; k = k >> 1) |
| { |
| n1 = n2; |
| n2 = n2 >> 1; |
| ia = 0; |
|
|
| |
| j = 0; |
| do |
| { |
| cosVal = pCoef[ia * 2]; |
| sinVal = pCoef[(ia * 2) + 1]; |
| ia = ia + twidCoefModifier; |
|
|
| |
| i = j; |
| do |
| { |
| l = i + n2; |
| a0 = (_Float16)pSrc[2 * i] + (_Float16)pSrc[2 * l]; |
| xt = (_Float16)pSrc[2 * i] - (_Float16)pSrc[2 * l]; |
|
|
| yt = (_Float16)pSrc[2 * i + 1] - (_Float16)pSrc[2 * l + 1]; |
| a1 = (_Float16)pSrc[2 * l + 1] + (_Float16)pSrc[2 * i + 1]; |
|
|
| p0 = (_Float16)xt * (_Float16)cosVal; |
| p1 = (_Float16)yt * (_Float16)sinVal; |
| p2 = (_Float16)yt * (_Float16)cosVal; |
| p3 = (_Float16)xt * (_Float16)sinVal; |
|
|
| pSrc[2 * i] = a0; |
| pSrc[2 * i + 1] = a1; |
|
|
| pSrc[2 * l] = (_Float16)p0 - (_Float16)p1; |
| pSrc[2 * l + 1] = (_Float16)p2 + (_Float16)p3; |
|
|
| i += n1; |
| } while ( i < fftLen ); |
| j++; |
| } while ( j < n2 ); |
|
|
| twidCoefModifier = twidCoefModifier << 1U; |
| } |
|
|
| n1 = n2; |
| n2 = n2 >> 1; |
|
|
| |
| for (i = 0; i < fftLen; i += n1) |
| { |
| l = i + n2; |
|
|
| a0 = (_Float16)pSrc[2 * i] + (_Float16)pSrc[2 * l]; |
| xt = (_Float16)pSrc[2 * i] - (_Float16)pSrc[2 * l]; |
|
|
| a1 = (_Float16)pSrc[2 * l + 1] + (_Float16)pSrc[2 * i + 1]; |
| yt = (_Float16)pSrc[2 * i + 1] - (_Float16)pSrc[2 * l + 1]; |
|
|
| p0 = (_Float16)a0 * (_Float16)onebyfftLen; |
| p2 = (_Float16)xt * (_Float16)onebyfftLen; |
| p1 = (_Float16)a1 * (_Float16)onebyfftLen; |
| p3 = (_Float16)yt * (_Float16)onebyfftLen; |
|
|
| pSrc[2 * i] = p0; |
| pSrc[2U * l] = p2; |
|
|
| pSrc[2 * i + 1] = p1; |
| pSrc[2U * l + 1U] = p3; |
| } |
|
|
| #endif |
|
|
| } |
|
|
|
|
| #endif |
|
|
| #endif |
|
|