Skip to content

Commit 8ea5e9a

Browse files
committed
Minor bug fixes in scalar_born.cu and elastic.cu. Untested.
1 parent 0c61fc6 commit 8ea5e9a

2 files changed

Lines changed: 315 additions & 465 deletions

File tree

src/deepwave/elastic.cu

Lines changed: 30 additions & 18 deletions
Original file line numberDiff line numberDiff line change
@@ -668,12 +668,9 @@ __global__ void forward_kernel_v(
668668
int64_t x = blockIdx.x * blockDim.x + threadIdx.x;
669669
int64_t y = blockIdx.y * blockDim.y + threadIdx.y;
670670
int64_t shot_idx = blockIdx.z * blockDim.z + threadIdx.z;
671-
int64_t z = 0;
672671
#else /* DW_NDIM == 1 */
673672
int64_t x = blockIdx.x * blockDim.x + threadIdx.x;
674673
int64_t shot_idx = blockIdx.y * blockDim.y + threadIdx.y;
675-
int64_t z = 0;
676-
int64_t y = 0;
677674
#endif
678675

679676
#if DW_NDIM == 3
@@ -899,12 +896,9 @@ __global__ void forward_kernel_sigma(
899896
int64_t x = blockIdx.x * blockDim.x + threadIdx.x;
900897
int64_t y = blockIdx.y * blockDim.y + threadIdx.y;
901898
int64_t shot_idx = blockIdx.z * blockDim.z + threadIdx.z;
902-
int64_t z = 0;
903899
#else /* DW_NDIM == 1 */
904900
int64_t x = blockIdx.x * blockDim.x + threadIdx.x;
905901
int64_t shot_idx = blockIdx.y * blockDim.y + threadIdx.y;
906-
int64_t z = 0;
907-
int64_t y = 0;
908902
#endif
909903

910904
#if DW_NDIM == 3
@@ -924,9 +918,9 @@ __global__ void forward_kernel_sigma(
924918
#if DW_NDIM >= 2
925919
int64_t const pml_y0h = pml_y0;
926920
int64_t const pml_y1h = MAX(pml_y0, pml_y1 - 1);
927-
#endif
928921
int64_t const pml_x0h = pml_x0;
929922
int64_t const pml_x1h = MAX(pml_x0, pml_x1 - 1);
923+
#endif
930924

931925
#if DW_NDIM == 3
932926
int64_t j = z * ny * nx + y * nx + x;
@@ -1168,12 +1162,9 @@ __global__ void backward_kernel_sigma(
11681162
int64_t x = blockIdx.x * blockDim.x + threadIdx.x;
11691163
int64_t y = blockIdx.y * blockDim.y + threadIdx.y;
11701164
int64_t shot_idx = blockIdx.z * blockDim.z + threadIdx.z;
1171-
int64_t z = 0;
11721165
#else /* DW_NDIM == 1 */
11731166
int64_t x = blockIdx.x * blockDim.x + threadIdx.x;
11741167
int64_t shot_idx = blockIdx.y * blockDim.y + threadIdx.y;
1175-
int64_t z = 0;
1176-
int64_t y = 0;
11771168
#endif
11781169

11791170
#if DW_NDIM == 3
@@ -1435,12 +1426,9 @@ __global__ void backward_kernel_v(
14351426
int64_t x = blockIdx.x * blockDim.x + threadIdx.x;
14361427
int64_t y = blockIdx.y * blockDim.y + threadIdx.y;
14371428
int64_t shot_idx = blockIdx.z * blockDim.z + threadIdx.z;
1438-
int64_t z = 0;
14391429
#else /* DW_NDIM == 1 */
14401430
int64_t x = blockIdx.x * blockDim.x + threadIdx.x;
14411431
int64_t shot_idx = blockIdx.y * blockDim.y + threadIdx.y;
1442-
int64_t z = 0;
1443-
int64_t y = 0;
14441432
#endif
14451433

14461434
#if DW_NDIM == 3
@@ -1485,9 +1473,9 @@ __global__ void backward_kernel_v(
14851473
#if DW_NDIM >= 2
14861474
int64_t const pml_y0h = pml_y0;
14871475
int64_t const pml_y1h = MAX(pml_y0, pml_y1 - 1);
1488-
#endif
14891476
int64_t const pml_x0h = pml_x0;
14901477
int64_t const pml_x1h = MAX(pml_x0, pml_x1 - 1);
1478+
#endif
14911479

14921480
#if DW_NDIM == 3
14931481
int64_t j = z * ny * nx + y * nx + x;
@@ -2506,8 +2494,20 @@ extern "C"
25062494
#if DW_NDIM >= 2
25072495
m_sigmayyy, m_sigmaxyy, m_sigmaxyx,
25082496
#endif
2509-
m_sigmaxxx, dvxdbuoyancy + store_i, dvxdbuoyancy + store_i,
2510-
dvxdbuoyancy + store_i, grad_buoyancy_z_shot, grad_buoyancy_y_shot,
2497+
m_sigmaxxx,
2498+
#if DW_NDIM >= 3
2499+
dvzdbuoyancy + store_i,
2500+
#endif
2501+
#if DW_NDIM >= 2
2502+
dvydbuoyancy + store_i,
2503+
#endif
2504+
dvxdbuoyancy + store_i,
2505+
#if DW_NDIM >= 3
2506+
grad_buoyancy_z_shot,
2507+
#endif
2508+
#if DW_NDIM >= 2
2509+
grad_buoyancy_y_shot,
2510+
#endif
25112511
grad_buoyancy_x_shot,
25122512
#if DW_NDIM >= 3
25132513
az, azh, bz, bzh,
@@ -2567,8 +2567,20 @@ extern "C"
25672567
#if DW_NDIM >= 2
25682568
m_sigmayyyn, m_sigmaxyyn, m_sigmaxyxn,
25692569
#endif
2570-
m_sigmaxxxn, dvxdbuoyancy + store_i, dvxdbuoyancy + store_i,
2571-
dvxdbuoyancy + store_i, grad_buoyancy_z_shot, grad_buoyancy_y_shot,
2570+
m_sigmaxxxn,
2571+
#if DW_NDIM >= 3
2572+
dvzdbuoyancy + store_i,
2573+
#endif
2574+
#if DW_NDIM >= 2
2575+
dvydbuoyancy + store_i,
2576+
#endif
2577+
dvxdbuoyancy + store_i,
2578+
#if DW_NDIM >= 3
2579+
grad_buoyancy_z_shot,
2580+
#endif
2581+
#if DW_NDIM >= 2
2582+
grad_buoyancy_y_shot,
2583+
#endif
25722584
grad_buoyancy_x_shot,
25732585
#if DW_NDIM >= 3
25742586
az, azh, bz, bzh,

0 commit comments

Comments
 (0)