cuda生成汉宁窗代码
·
__global__ void hann(float * cos_window, int rows, int cols)//输入参数:数据指针,行数,列数
{
int tidx = threadIdx.x + blockDim.x*blockIdx.x;
int tidy = threadIdx.y + blockDim.y*blockIdx.y;
float row_charac = 0.5 - 0.5*(cos((2 * pi*tidx) / (rows - 1)));
float col_charac = 0.5 - 0.5*(cos((2 * pi*tidy) / (cols - 1)));
if (tidx<rows&&tidy<cols)
cos_window[tidx*cols + tidy] = row_charac*col_charac;
}
{
int tidx = threadIdx.x + blockDim.x*blockIdx.x;
int tidy = threadIdx.y + blockDim.y*blockIdx.y;
float row_charac = 0.5 - 0.5*(cos((2 * pi*tidx) / (rows - 1)));
float col_charac = 0.5 - 0.5*(cos((2 * pi*tidy) / (cols - 1)));
if (tidx<rows&&tidy<cols)
cos_window[tidx*cols + tidy] = row_charac*col_charac;
}
欢迎来到FlagOS开发社区,这里是一个汇聚了AI开发者、数据科学家、机器学习爱好者以及业界专家的活力平台。我们致力于成为业内领先的Triton技术交流与应用分享的殿堂,为推动人工智能技术的普及与深化应用贡献力量。
更多推荐



所有评论(0)