#include <assert.h>
#include <omp.h>
#include <stdio.h>
#pragma omp begin declare variant match(device = {kind(gpu)})
unsigned long long __llvm_omp_host_call(void *fn, void *args, size_t size);
#pragma omp declare target to(__llvm_omp_host_call) device_type(nohost)
#pragma omp end declare variant
#pragma omp begin declare variant match(device = {kind(cpu)})
unsigned long long __llvm_omp_host_call(void *fn, void *args, size_t size) {
return ((unsigned long long (*)(void *))fn)(args);
}
#pragma omp end declare variant
typedef struct args_s {
int thread_id;
int block_id;
} args_t;
unsigned long long foo(void *data) {
assert(omp_is_initial_device() && "Not executing on host?");
args_t *args = (args_t *)data;
printf("Thread: %d, Block: %d\n", args->thread_id, args->block_id);
return 42;
}
void *fn_ptr = NULL;
#pragma omp declare target to(fn_ptr)
int main() {
fn_ptr = (void *)&foo;
#pragma omp target update to(fn_ptr)
int failed = 0;
#pragma omp target teams num_teams(4) map(tofrom : failed)
#pragma omp parallel num_threads(2)
{
args_t args = {omp_get_thread_num(), omp_get_team_num()};
unsigned long long res =
__llvm_omp_host_call(fn_ptr, &args, sizeof(args_t));
if (res != 42)
#pragma omp atomic write
failed = 1;
}
if (!failed)
printf("PASS\n");
}