Prepare Language Model Dataset

Prepare language-model training, preference, red-team, or evaluation datasets. Use when collecting, filtering, deduplicating, templating, splitting, or auditing examples for provenance, leakage, consent, or sensitive data.

gaelic-ghost fd86748 4 files · 4.5 KB Updated

File contents

gaelic-ghost/socket/tree/main/skills/prepare-language-model-dataset commit fd86748fdb

Frequently asked questions

npx skillmds@latest add gaelic-ghost/prepare-language-model-dataset