RealDiv
=================
逐元素计算两个输入的除法。

.. math::

    output_i = \frac{input0_i}{input1_i}

输入：
    - **input0** - 被除数输入数据地址。  
    - **input1** - 除数输入数据地址。  
    - **length** - 计算长度。  
    - **core_mask(int, 可选)** - 核掩码（仅适用于共享存储版本）。 

输出：
    - **output** - 计算结果地址。  

支持平台：
    ``FT78NE``  
    ``MT7004``  

.. note::
    - FT78NE 支持 int8, int16, int32, fp32, fp64, cplx64, cplx128  
    - MT7004 支持 fp16, fp32, int16, int32, cplx64  
    - 若除数元素为 0，则输出结果为无穷大或未定义值，需由上层逻辑处理。  

**共享存储版本:**

.. c:function:: void i8_real_div_s(int8_t* input0, int8_t* input1, int8_t* output, int length, int core_mask)
.. c:function:: void i16_real_div_s(int16_t* input0, int16_t* input1, int16_t* output, int length, int core_mask)
.. c:function:: void i32_real_div_s(int32_t* input0, int32_t* input1, int32_t* output, int length, int core_mask)
.. c:function:: void hp_real_div_s(half* input0, half* input1, half* output, int length, int core_mask)
.. c:function:: void fp_real_div_s(float* input0, float* input1, float* output, int length, int core_mask)
.. c:function:: void dp_real_div_s(double* input0, double* input1, double* output, int length, int core_mask)
.. c:function:: void c64_real_div_s(float* input0, float* input1, float* output, int length, int core_mask)
.. c:function:: void c128_real_div_s(double* input0, double* input1, double* output, int length, int core_mask)

    **C调用示例：**

    .. code-block:: c
        :linenos:
        :emphasize-lines: 10

        //FT78NE示例
        #include <stdio.h>

        int main(int argc, char* argv[]) {
            float *input0 = (float *)0xA0000000;   // input0 在 DDR 空间
            float *input1 = (float *)0xA1000000;   // input1 在 DDR 空间
            float *output = (float *)0xB0000000;   // 输出结果在 DDR 空间
            int length = 1024;
            int core_mask = 0xff;
            fp_real_div_s(input0, input1, output, length, core_mask);
            return 0;
        }


**私有存储版本:**

.. c:function:: void i8_real_div_p(int8_t* input0, int8_t* input1, int8_t* output, int length)
.. c:function:: void i16_real_div_p(int16_t* input0, int16_t* input1, int16_t* output, int length)
.. c:function:: void i32_real_div_p(int32_t* input0, int32_t* input1, int32_t* output, int length)
.. c:function:: void hp_real_div_p(half* input0, half* input1, half* output, int length)
.. c:function:: void fp_real_div_p(float* input0, float* input1, float* output, int length)
.. c:function:: void dp_real_div_p(double* input0, double* input1, double* output, int length)
.. c:function:: void c64_real_div_p(float* input0, float* input1, float* output, int length)
.. c:function:: void c128_real_div_p(double* input0, double* input1, double* output, int length)

    **C调用示例：**

    .. code-block:: c
        :linenos:
        :emphasize-lines: 9

        //MT7004 示例
        #include <stdio.h>

        int main(int argc, char* argv[]) {
            float *input0 = (float *)0x10000000;   
            float *input1 = (float *)0x10001000;  
            float *output = (float *)0x10002000; 
            int length = 1024;
            fp_real_div_p(input0, input1, output, length);
            return 0;
        }
