batched matmul cuda
This commit is contained in:
parent
82a854ff11
commit
5da5a7ad0d
4 changed files with 40 additions and 1 deletions
|
|
@ -695,7 +695,7 @@ extern "C" {
|
|||
|
||||
float* result_data;
|
||||
cudaMalloc((void **)&result_data, size * sizeof(float));
|
||||
//batched_matmul_tensor_cuda(tensor1, tensor2, result_data);
|
||||
batched_matmul_tensor_cuda(tensor1, tensor2, result_data);
|
||||
return create_tensor(result_data, shape, ndim, device);
|
||||
}
|
||||
else {
|
||||
|
|
|
|||
Loading…
Add table
Add a link
Reference in a new issue