Cupynumeric Parallel Data Load

Load a sharded, on-disk dataset (sharded .npy, Parquet/Arrow, raw binary, sharded HDF5, custom layouts) into a distributed cuPyNumeric ndarray via a manual partition + leaf @task launch with CPU/OMP/GPU variants. Use when no single-call loader fits, including when per-shard row counts differ across files. Prefer cupynumeric.load or legate.io.hdf5.from_file when they apply.

NVIDIA Updated 2.2k repo stars

File contents

NVIDIA/skills/tree/main/skills/cupynumeric-parallel-data-load commit 4c9e683504

Frequently asked questions

npx skillmds@latest add nvidia/cupynumeric-parallel-data-load-2