1. 程式人生 > >CUDA8.0+VS2013的安裝和配置

CUDA8.0+VS2013的安裝和配置

  1 // CUDA runtime 庫 + CUBLAS 庫 
  2 #include "cuda_runtime.h"
  3 #include "cublas_v2.h"
  4 
  5 #include <time.h>
  6 #include <iostream>
  7 
  8 using namespace std;
  9 
 10 // 定義測試矩陣的維度
 11 int const M = 5;
 12 int const N = 10;
 13 
 14 int main() 
 15 {   
 16     // 定義狀態變數
 17     cublasStatus_t status;
18 19 // 在 記憶體 中為將要計算的矩陣開闢空間 20 float *h_A = (float*)malloc (N*M*sizeof(float)); 21 float *h_B = (float*)malloc (N*M*sizeof(float)); 22 23 // 在 記憶體 中為將要存放運算結果的矩陣開闢空間 24 float *h_C = (float*)malloc (M*M*sizeof(float)); 25 26 // 為待運算矩陣的元素賦予 0-10 範圍內的隨機數 27 for (int i=0
; i<N*M; i++) { 28 h_A[i] = (float)(rand()%10+1); 29 h_B[i] = (float)(rand()%10+1); 30 31 } 32 33 // 列印待測試的矩陣 34 cout << "矩陣 A :" << endl; 35 for (int i=0; i<N*M; i++){ 36 cout << h_A[i] << " "; 37 if ((i+1)%N == 0
) cout << endl; 38 } 39 cout << endl; 40 cout << "矩陣 B :" << endl; 41 for (int i=0; i<N*M; i++){ 42 cout << h_B[i] << " "; 43 if ((i+1)%M == 0) cout << endl; 44 } 45 cout << endl; 46 47 /* 48 ** GPU 計算矩陣相乘 49 */ 50 51 // 建立並初始化 CUBLAS 庫物件 52 cublasHandle_t handle; 53 status = cublasCreate(&handle); 54 55 if (status != CUBLAS_STATUS_SUCCESS) 56 { 57 if (status == CUBLAS_STATUS_NOT_INITIALIZED) { 58 cout << "CUBLAS 物件例項化出錯" << endl; 59 } 60 getchar (); 61 return EXIT_FAILURE; 62 } 63 64 float *d_A, *d_B, *d_C; 65 // 在 視訊記憶體 中為將要計算的矩陣開闢空間 66 cudaMalloc ( 67 (void**)&d_A, // 指向開闢的空間的指標 68 N*M * sizeof(float) // 需要開闢空間的位元組數 69 ); 70 cudaMalloc ( 71 (void**)&d_B, 72 N*M * sizeof(float) 73 ); 74 75 // 在 視訊記憶體 中為將要存放運算結果的矩陣開闢空間 76 cudaMalloc ( 77 (void**)&d_C, 78 M*M * sizeof(float) 79 ); 80 81 // 將矩陣資料傳遞進 視訊記憶體 中已經開闢好了的空間 82 cublasSetVector ( 83 N*M, // 要存入視訊記憶體的元素個數 84 sizeof(float), // 每個元素大小 85 h_A, // 主機端起始地址 86 1, // 連續元素之間的儲存間隔 87 d_A, // GPU 端起始地址 88 1 // 連續元素之間的儲存間隔 89 ); 90 cublasSetVector ( 91 N*M, 92 sizeof(float), 93 h_B, 94 1, 95 d_B, 96 1 97 ); 98 99 // 同步函式 100 cudaThreadSynchronize(); 101 102 // 傳遞進矩陣相乘函式中的引數,具體含義請參考函式手冊。 103 float a=1; float b=0; 104 // 矩陣相乘。該函式必然將陣列解析成列優先陣列 105 cublasSgemm ( 106 handle, // blas 庫物件 107 CUBLAS_OP_T, // 矩陣 A 屬性引數 108 CUBLAS_OP_T, // 矩陣 B 屬性引數 109 M, // A, C 的行數 110 M, // B, C 的列數 111 N, // A 的列數和 B 的行數 112 &a, // 運算式的 α 值 113 d_A, // A 在視訊記憶體中的地址 114 N, // lda 115 d_B, // B 在視訊記憶體中的地址 116 M, // ldb 117 &b, // 運算式的 β 值 118 d_C, // C 在視訊記憶體中的地址(結果矩陣) 119 M // ldc 120 ); 121 122 // 同步函式 123 cudaThreadSynchronize(); 124 125 // 從 視訊記憶體 中取出運算結果至 記憶體中去 126 cublasGetVector ( 127 M*M, // 要取出元素的個數 128 sizeof(float), // 每個元素大小 129 d_C, // GPU 端起始地址 130 1, // 連續元素之間的儲存間隔 131 h_C, // 主機端起始地址 132 1 // 連續元素之間的儲存間隔 133 ); 134 135 // 列印運算結果 136 cout << "計算結果的轉置 ( (A*B)的轉置 ):" << endl; 137 138 for (int i=0;i<M*M; i++){ 139 cout << h_C[i] << " "; 140 if ((i+1)%M == 0) cout << endl; 141 } 142 143 // 清理掉使用過的記憶體 144 free (h_A); 145 free (h_B); 146 free (h_C); 147 cudaFree (d_A); 148 cudaFree (d_B); 149 cudaFree (d_C); 150 151 // 釋放 CUBLAS 庫物件 152 cublasDestroy (handle); 153 154 getchar(); 155 156 return 0; 157 }

相關推薦

筆記本雙顯示卡ubuntu16.04系統 cuda8.0安裝配置

1 CUDA安裝 1.1 安裝前的檢查 1.1.1 確認具備支援cuda的NVIDIA 顯示卡 輸入lspci | grep -i nvidia,確認計算機搭載Nvidia的獨立顯示卡,並且該型號支援CUDA. https://developer.nvidia.co

0-1安裝配置kubectl

powers -i 功能 ces 嘗試 current gpgkey 部署 命令行工具 使用k8s的命令行工具 kubectl 來部署和管理應用。可以用kubectl 來查看集群的資源,創建,刪除,更新組件,查看你的新集群,啟動測試的應用。 開始之前 你必須使用和你的集群的

Linux下MongoDB(3.0)的安裝配置使用者

1.下載MongoDB安裝包 wget https://fastdl.mongodb.org/linux/mongodb-linux-x86_64-ubuntu1404-3.2.7.tgz 2.解壓MongoDB安裝包 tar -zxvf mongo

CentOS 7.0安裝配置 VNC 服務器

run 雙引號 我們 rhel 7 control linux fault 系統管理員 daemon 作為一個系統管理員,大多數時間是通過網絡管理服務器的。在管理服務器的過程中很少會用到圖形界面,多數情況下我們只是用 SSH 來完成我們的管理任務。在這篇文章裏,我們將配置

Maven 3.0.5 安裝配置

摘要:現在的Web專案越來越多的都用maven管理了,所以我也抽時間學習學習,為了趕上時代! 一:首先到maven官網:http://maven.apache.org/,然後選擇相應的版本下載,我這裡

Win10+vs2012+cuda8.0安裝配置

  安裝環境說明:NVDIA GeForce 930M、Intel(R) HD Graphics 520   顯示卡和cuda需要相容匹配,我一開始下載的cuda6.5無法安裝,所以又重新下了比較新的cuda8.0。   一、自行安裝vs2012,   二、安裝cuda8.

CUDA8.0+VS2013安裝配置

1 // CUDA runtime 庫 + CUBLAS 庫 2 #include "cuda_runtime.h" 3 #include "cublas_v2.h" 4 5 #include <time.h> 6 #include <iostream>

Cisco模擬器GNS3(2.0.0b4版本)安裝配置

設備 適用於 實驗 交換機 運行時 裏的 https sco style GNS3(2.0.0b4版本)(適用於CCNA和CCNP) 下載地址:https://www.gns3.com/software 包含GNS3.exe和GSN3 VM 註意下載

roseMirrorHA5.0 for WindowsServer2008R2配合sqlserver2012|Oracle 11g的安裝配置

HA enter 不能 server2 framework win alt 復制 2008r2 備註: 1.文字註釋解釋的是上面的圖片。 2.此文檔是在虛擬機中實驗做出來的,實際生產環境可能會遇到其他的問題。如果遇到解決不了的問題,請聯系我。 吐槽:為啥不能Word

Jmeter4.0下載地址與安裝配置

一、下載地址  http://jmeter.apache.org/download_jmeter.cgi 最新版本  歷史版本(任意下載你想要的版本) 注意:我安裝的是Jmeter4.0,配置的JDK1.8(4.0需在1.8及1.8以上) 二

CentOS6.8下Nagios-4.2.0安裝配置

因此 figure 問題 usermod linux文件 httpd的配置 pen kconfig etc 1實驗目標 掌握Nagios的安裝 2實驗環境 主機名:Nagios-Server 操作系統:CentOS release 6.8 (Final) IP地址:19

zabbix4.0安裝配置

                                以下為master端安裝,開始 核心$ cat /etc/centos-release   CentOS Linux release 7.4.1708 (Core) $ uname -r   3.10.0-693.el7.x86_64 IP

03. CouchBase叢集安裝配置(02)-CouchBase從0到50

4.叢集配置 couchbase叢集可以採用2種方式配置 直接ip叢集互聯 通過hostname叢集互聯 為了方便以後的維護和變更,我們採用hostname的進行配置。 首先確保三臺測試機之間網路互通,防護牆,selinux和埠之類的都配置ok了。 4.1 hosts設定 配置三臺機

linux ubuntu 下 mongodb 4.0 安裝配置遠端連線

安裝 搬運: 安裝教程 選擇對應版本,複製貼上命令即可,這裡就不涉及了。 安裝完成後啟動服務:sudo service mongod start 如果提示Unit mon

生成環境下的Tomcat 8.0.36 在CentOS7下安裝配置apr

# cd /usr/local/src # wget http://apache.fayea.com//apr/apr-1.5.2.tar.gz # tar -xzvf apr-1.5.

node.js學習1.0-安裝配置

 1、開啟NodeJS的官網,下載和自己系統相配的NodeJS的安裝程式,包括32位還是64位一定要選擇好,否則會出現安裝問題。          我選擇的是Window版本64位的安裝程式,也有MAC平臺的安裝程式。     下載完成,如圖:     2、接下來就是安裝了,

MySql8.0.11在windows下安裝配置

一、下載: 解壓到想要的位置 二、配置 配置my.ini 沒有按網上的說法找到my.ini配置檔案的位置,C:\ProgramData下找不到MySQL資料夾。 於是複製了別人的一份my.ini到解壓後的資料夾下,似乎是優先生效的,沒有問題。 # Othe

Kafka-0.10.1叢集的安裝配置

準備 1.kafka_2.10-0.10.1.1.tgz 2.安裝配置好的Zookeeper-3.4.10分散式叢集 mini1:192.168.213.133 mini2:192.168.213.134 mini3:192.168.213.135

james3.0郵件伺服器的安裝配置

1.先在官網下載apache-james-3.0-beta4-app.zip; 2.解壓該壓縮包 為 apache-james-3.0-beta4; 3.開啟cmd.exe.輸入命令列進入該檔案。 4.執行結束後會出現各個埠的埠號。 5.然後再執行james instal

CentOS7.0 mosquitto的安裝配置

加入yum源 在/etc/yum.repos.d/目錄中新建一個mosquitto.repo檔案,裡面寫入: [home_oojah_mqtt] name=mqtt (CentOS_CentOS-7) type=rpm-md baseurl=ht