1#ifndef __MATH_AX_HELM_KERNEL_H__
2#define __MATH_AX_HELM_KERNEL_H__
48#ifndef NEKO_AX_HELM_VECTOR_EB_C
49#define NEKO_AX_HELM_VECTOR_EB_C 0
56template<
typename T, const
int LX, const
int CHUNKS >
130 for (
int l = 0; l<
LX; l++){
152 for (
int l = 0; l<
LX; l++){
163template<
typename T, const
int LX, const
int EB >
189 static_assert(
sizeof(
shdx) +
196 "kstep block exceeds the shared memory budget");
232 for (
int k = 0;
k <
LX; ++
k){
244 for (
int l = 0; l <
LX; l++){
252 for (
int l = 0; l <
LX; l++){
273 for (
int l = 0; l <
LX; l++){
282 for (
int k = 0;
k <
LX; ++
k){
293template<
typename T, const
int LX, const
int EB >
319 static_assert(
sizeof(
shdx) +
326 "kstep block exceeds the shared memory budget");
353 for(
int k = 0;
k <
LX; ++
k){
361 for (
int k = 0;
k <
LX; ++
k){
373 for (
int l = 0; l <
LX; l++){
381 for (
int l = 0; l <
LX; l++){
402 for (
int l = 0; l <
LX; l++){
411 for (
int k = 0;
k <
LX; ++
k){
421template<
typename T, const
int LX, const
int EB >
459 static_assert(
sizeof(
shdx) +
472 "kstep block exceeds the shared memory budget");
505 for(
int k = 0;
k <
LX; ++
k){
519 for (
int k = 0;
k <
LX; ++
k){
535 for (
int l = 0; l <
LX; l++){
551 for (
int l = 0; l <
LX; l++){
607 for (
int l = 0; l <
LX; l++){
626 for (
int k = 0;
k <
LX; ++
k){
634template<
typename T, const
int LX, const
int EB >
672 static_assert(
sizeof(
shdx) +
685 "kstep block exceeds the shared memory budget");
720 for(
int k = 0;
k <
LX; ++
k){
734 for (
int k = 0;
k <
LX; ++
k){
750 for (
int l = 0; l <
LX; l++){
766 for (
int l = 0; l <
LX; l++){
822 for (
int l = 0; l <
LX; l++){
841 for (
int k = 0;
k <
LX; ++
k){
849template<
typename T >
863 for (
int i = idx;
i < n;
i +=
str) {
__global__ void ale_add_kinematics_kernel(const int n, T *__restrict__ wx, T *__restrict__ wy, T *__restrict__ wz, const T *__restrict__ x_ref, const T *__restrict__ y_ref, const T *__restrict__ z_ref, const T *__restrict__ phi, const T *__restrict__ x, const T *__restrict__ y, const T *__restrict__ z, const kinematics_params_t kin_params)
__global__ void const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const int nelv
__shared__ T shus[EB *LX *LX]
__global__ void const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ g23
__global__ void const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ g22
__global__ void T *__restrict__ av
__shared__ T shv[EB *LX *LX]
__shared__ T shwr[EB *LX *LX]
__global__ void const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ g13
__global__ void ax_helm_kernel_1d(T *__restrict__ w, const T *__restrict__ u, const T *__restrict__ dx, const T *__restrict__ dy, const T *__restrict__ dz, const T *__restrict__ dxt, const T *__restrict__ dyt, const T *__restrict__ dzt, const T *__restrict__ h1, const T *__restrict__ g11, const T *__restrict__ g22, const T *__restrict__ g33, const T *__restrict__ g12, const T *__restrict__ g13, const T *__restrict__ g23)
__shared__ T shur[EB *LX *LX]
__shared__ T shvs[EB *LX *LX]
__global__ void const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ g12
__shared__ T shw[EB *LX *LX]
__shared__ T shws[EB *LX *LX]
__shared__ T shu[EB *LX *LX]
__global__ void T *__restrict__ T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ w
__global__ void const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ g33
__global__ void T *__restrict__ T *__restrict__ aw
__shared__ T shvr[EB *LX *LX]
__global__ void const T *__restrict__ u
__global__ void const T *__restrict__ const T *__restrict__ dx
__global__ void const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ dz
__shared__ T shdz[LX *LX]
__global__ void const T *__restrict__ const T *__restrict__ const T *__restrict__ dy
__global__ void const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ h1
__global__ void const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ g11
__global__ void T *__restrict__ T *__restrict__ const T *__restrict__ const T *__restrict__ v
__global__ void ax_helm_kernel_vector_part2(T *__restrict__ au, T *__restrict__ av, T *__restrict__ aw, const T *__restrict__ u, const T *__restrict__ v, const T *__restrict__ w, const T *__restrict__ h2, const T *__restrict__ B, const int n)
__shared__ T shdy[LX *LX]
__shared__ T shdzt[LX *LX]
__global__ void const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ dzt
__shared__ T shdyt[LX *LX]
__global__ void const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ dyt
__global__ void const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ const T *__restrict__ dxt
#define NEKO_EB_BOUNDS(NT)