不使用内在函数在不同架构上进行向量化
创始人
2024-12-29 03:00:13
0
  1. 使用OpenMP指令向量化代码。
#pragma omp simd
for (int i = 0; i < num_elements; i++) {
  output[i] = input1[i] + input2[i];
}
  1. 使用GCC的向量扩展选项将代码向量化。
typedef float float8 __attribute__ ((vector_size (32)));
float8 *input1_v = (float8*)input1;
float8 *input2_v = (float8*)input2;
float8 *output_v = (float8*)output;

for (int i = 0; i < num_elements/8; i++) {
  output_v[i] = input1_v[i] + input2_v[i];
}
  1. 使用Intel C++编译器的向量函数进行向量化。
#include 

__m256 add_simd(__m256 a, __m256 b) {
  return _mm256_add_ps(a, b);
}

__m256 *input1_v = (__m256*)input1;
__m256 *input2_v = (__m256*)input2;
__m256 *output_v = (__m256*)output;

for (int i = 0; i < num_elements/8; i++) {
  output_v[i] = add_simd(input1_v[i], input2_v[i]);
}

相关内容

热门资讯

一分钟黑科技!一起跑得快外挂,... 一分钟黑科技!一起跑得快外挂,德扑之星开桌可以设置(详细透视辅助工具教程);是一款可以让一直输的玩家...
六分钟透明!友乐麻将赢牌器,德... 此外,数据分析德州(友乐麻将赢牌器)辅助神器app还具备辅助透视行为开挂功能,通过对客户友乐麻将赢牌...
9分钟透明!兴动互娱最强辅助神... 9分钟透明!兴动互娱最强辅助神器下载,pokermaster外 挂(详细透视辅助脚本教程)是一款可以...
三分钟教学!决战卡五星外 挂,... 三分钟教学!决战卡五星外 挂,德州之星辅助挂(详细透视辅助软件教程);决战卡五星外 挂软件透明挂作为...
六分钟了解!蜀山四川麻将怎么让... 六分钟了解!蜀山四川麻将怎么让系统发好牌,wpk德州伙牌打法(详细透视辅助挂教程);超受欢迎的蜀山四...
十分钟总结!打牌网十三道有挂吗... 《十分钟总结!打牌网十三道有挂吗,wpk数据统计(详细透视辅助app教程)》 打牌网十三道有挂吗软件...
七分钟方法!友乐麻将赢牌,we... 七分钟方法!友乐麻将赢牌,wepoke真的有挂嘛(详细透视辅助脚本教程);超受欢迎的wepoke真的...
4分钟黑科技!皮皮跑胡子有辅助... 4分钟黑科技!皮皮跑胡子有辅助吗,红龙扑克是有问题(详细透视辅助器教程)关于皮皮跑胡子有辅助吗的基本...
8分钟黑科技!大凉山生活号跑得... 8分钟黑科技!大凉山生活号跑得快辅助,pokernow可以开挂(详细透视辅助助手教程);(需添加指定...
一分钟规律!蜜瓜大厅拼三张小,... 一分钟规律!蜜瓜大厅拼三张小,fishpoker大菠萝外 挂(详细透视辅助插件教程);亲,其实确实真...