腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(9999+)
视频
沙龙
1
回答
Cublas
-
列
/
行
操作
cuda
、
gpu
、
thrust
、
cublas
我正在寻找一种在列上执行
操作
的方法。我有MxN矩阵,我想在每一
列
上激活
cublas
函数(例如nrm2)。我该怎么做呢?
浏览 4
提问于2018-08-30
得票数 0
1
回答
cublasSgemm
行
-主乘法
matrix
、
cuda
、
cublas
我试着用cublasSgemm来重复两个非平方矩阵,它们都是按
行
的主要顺序存储的。我知道这个函数有一个参数,您可以指定,如果您想要转置矩阵(
CUBLAS
_OP_T),但是结果是按
列
-主要顺序存储的,我也需要它在行-主。另外,我的代码不能用参数
CUBLAS
_OP_T乘以非平方矩阵,只有平方或非平方与
CUBLAS
_OP_N相乘。 int print = 1; cudaError_t cudaStat; //
浏览 0
提问于2019-05-08
得票数 2
回答已采纳
1
回答
如何使用blas以最佳方式转置矩阵?
c
、
cuda
、
blas
、
cublas
我正在测试
cuBlas
,在图形处理器上做linAlg看起来是个好主意,但有一个问题。 使用
列
主格式的
cuBlas
实现,由于这不是我最终需要的,我很好奇是否有一种方法可以让BLAS进行矩阵转置?
浏览 1
提问于2011-10-16
得票数 10
回答已采纳
1
回答
cublas
函数调用cublasSgemv
c
、
cuda
、
cublas
感谢@集线器,当调用cublasSgemv时,应该注意到
CUBLAS
_OP_T也是转置向量。/*I正在学习cuda和
cublas
一个月,我想测试
cublas
的性能以供进一步使用。我使用cudaMemcpy将它们发送到设备,并调用函数cublasSgemv,因为A是主要
行
,所以我使用参数
CUBLAS
_OP_T*/float alf=1.0;
浏览 4
提问于2014-01-16
得票数 2
回答已采纳
1
回答
特定格式的cublasSgemm矩阵乘法
matrix
、
cuda
、
matrix-multiplication
、
cublas
但是,A是
行
主格式,B是
列
主格式,我希望输出是
行
主格式。 这有可能吗?如果可能的话,我如何设置这些参数?
浏览 9
提问于2022-05-09
得票数 1
回答已采纳
2
回答
减少CUDA中的矩阵
行
或
列
cuda
、
cublas
我正在使用CUDA和
cuBLAS
来执行矩阵运算。有没有更好的办法?在
cuBLAS
里找不到任何东西。
浏览 0
提问于2013-01-10
得票数 5
回答已采纳
1
回答
cuBLAS
howto中的转置矩阵乘法
cuda
、
matrix-multiplication
、
transpose
、
blas
、
cublas
我知道
cuBlas
有一个cublasOperation_t枚举,用于预先转置内容,但不知何故,我没有完全正确地使用它。我的矩阵A和B是以行为主的顺序,即row1 row3 .....在设备内存中。= num_row_B, and k = num_col_A;// alpha = 1, beta = 0; // set up
cuBlas
cublasSgemm(handle,
CUBLAS
_OP_T,
CU
浏览 1
提问于2013-01-30
得票数 4
1
回答
矩阵逆通过
cublas
、cublasCreate异常或其他方法使用线性系统求解器
algorithm
、
cuda
、
gpu
、
cublas
、
linear-equation
可能有两个假设,要么我没有正确地使用
cublas
,要么
cublas
无缘无故地抛出异常。, cublasOperation_t::
CUBLAS
_OP_N, cublasFillMode_t::
CUBLAS
_FILL_MODE_UPPER,
浏览 3
提问于2013-06-16
得票数 2
回答已采纳
3
回答
是否有一个cuda函数可以在
列
大调中从矩阵中复制
行
?
cuda
、
cublas
我有一个设备矩阵U的维数MxN在
列
的主要顺序。现在我想把
行
K提取成向量u,有函数来完成这个任务吗?注意,拷贝需要考虑K的偏移量和M的步幅。我在看函数,但它听起来一点都不响,来自一个更LAPACK风格的API,我不明白这些音高参数是什么,为什么它们不是简单的
行
和科尔,或者M和N?
浏览 6
提问于2014-01-08
得票数 1
回答已采纳
3
回答
BLAS和
CUBLAS
boost
、
cuda
、
blas
、
cublas
我想知道NVIDIA的
cuBLAS
库。有谁有使用它的经验吗?例如,如果我使用BLAS编写C程序,我是否能够将对BLAS的调用替换为对
cuBLAS
的调用?或者更好地实现一种让用户在运行时选择的机制?
浏览 0
提问于2010-04-30
得票数 6
1
回答
如何找到torch.solve的源代码?
pytorch
、
linear-algebra
、
implementation
我关心的是,torch.solve()是否检查了线性系统的系数矩阵的条件并使用了理想的预条件;因此,我对它的实现细节感到好奇。我读了好几个答案,试图找到源文件,但没有结果。我希望有人能帮助我在ATen库中找到它的定义。
浏览 3
提问于2020-08-12
得票数 3
回答已采纳
2
回答
cuBLAS
同步最佳实践
c
、
cuda
、
cublas
如果我错了就纠正我cudaStream_t stream;
CUBLAS
_CALL(cublasDgemm(
cublas
_handle,
CUBLAS
_OP_N,
CUBLAS
_OP_N, M, M, /&
浏览 13
提问于2014-04-10
得票数 7
回答已采纳
1
回答
如何在复数上用
CUBLAS
实现Hadamard积?
cuda
、
gpu
、
nvidia
、
cublas
我需要用NVidia
CUBLAS
计算复数的两个向量(Hadamard乘积)的元素分乘。不幸的是,在
CUBLAS
没有民政事务总署的行动。显然,您可以使用SBMV
操作
来完成这个任务,但是它不是针对
CUBLAS
中的复数实现的。我不敢相信,没有办法做到这一点与中巴way。对于复数,有其他方法可以用
CUBLAS
来实现吗?我不能编写我自己的内核,我必须使用
CUBLAS
(或者另一个标准的NVIDIA库,如果它真的不可能使用
CUBLAS
)。
浏览 11
提问于2016-06-02
得票数 1
回答已采纳
1
回答
使用
cublas
saxpy时出错
c++
、
cuda
、
cublas
我正在尝试使用
cublas
中的cublasSaxpy函数。=
CUBLAS
_STATUS_SUCCESS) cout << "
CUBLAS
Initialization failed!"=
CUBLAS
_STATUS_SUCCESS) cout << "
CUBLAS
setting vector failed" << endl; exit(EXIT_FAILURE)=
CUBLAS
浏览 21
提问于2012-09-15
得票数 1
回答已采纳
2
回答
无法在Ubuntu 10.04,CUDA 5.0上编译MAGMA 1.3
linux
、
cuda
、
compiler-errors
、
fortran
、
ubuntu-10.04
我在此应用了所提出的解决方案,到目前为止,编译工作还在继续:gcc -O3 -DADD_ -DHAVE_
CUBLAS
浏览 6
提问于2013-01-17
得票数 1
回答已采纳
1
回答
CUDA/
CUBLAS
:访问数组中的元素
c++
、
vector
、
matrix
、
cuda
、
cublas
作为对前面一个问题的后续,我尝试实现以下循环,它是基于循环迭代器的矩阵向量乘法,其中向量是来自矩阵Q的
列
:编辑:乘以回忆录访问增量与大小(浮动)。据我所知还是不起作用。Niter = 0.5*N + 1; cublasSgemv(handle,
CUBLAS
_OP_T, N, N, &a
浏览 1
提问于2013-09-02
得票数 0
回答已采纳
1
回答
Cublas
_Dgemm()没有给出我期望的结果
matrix
、
cuda
、
cublas
我在一个小矩阵上试用库函数
Cublas
_Dgemm(),但它没有给出我所期望的结果。sa), sa, 2, dsa, 2); cublasGetMatrix(2, 2, sizeof(*sc
浏览 0
提问于2013-11-28
得票数 0
1
回答
如何修复
CUBLAS
_STATUS_ARCH_MISMATCH?
c++
、
cuda
、
cublas
我试图使用
CUBLAS
来执行一个简单的矩阵乘法。我使用以下函数//
cuBLAS
API errors return "
CUBLAS
_STATUS_INVALID_VALUE"; case
CUBLAS
_S
浏览 10
提问于2014-02-05
得票数 0
回答已采纳
1
回答
将指针返回到从C到Fortran的设备分配矩阵
c
、
cuda
、
fortran
、
intel-fortran
其次,我正在开发一个Fortran/C程序,它使用
cuBLAS
在GPU上执行矩阵向量乘法。在需要更新矩阵内容之前,我需要将多个向量(最多1000个)与一个矩阵相乘。
浏览 3
提问于2014-03-13
得票数 1
回答已采纳
3
回答
CUDA内核可以调用
cublas
函数吗?
parallel-processing
、
cuda
、
gpu
、
cublas
我搜索了
cublas
库,没有找到任何可以做到这一点的2级或3级函数。因此,我决定将A的每一
行
和B的每一
列
分配到CUDA线程中。现在由于这个点积也需要一些时间,我想知道我是否可以以某种方式调用
cublas
函数(比如cublasSdot)来实现它。如果我错过了一些可以直接实现我的目标的
cublas
函数(只计算矩阵-矩阵乘法的对角线元素),这个问题可能会被丢弃。
浏览 8
提问于2012-11-14
得票数 17
回答已采纳
点击加载更多
热门
标签
更多标签
云服务器
ICP备案
对象存储
即时通信 IM
云直播
活动推荐
运营活动
广告
关闭
领券