Hugging Face Vision Trainer

Trains and fine-tunes vision models for object detection (D-FINE, RT-DETR v2, DETR, YOLOS), image classification (timm models — MobileNetV3, MobileViT, ResNet, ViT/DINOv3 — plus any Transformers classifier), and SAM/SAM2 segmentation using Hugging Face Transformers on Hugging Face Jobs...

thedixitjain b24f918 12 files · 197.1 KB Updated 2 repo stars

File contents

thedixitjain/the-mega-skill-library/tree/main/library/data-science-and-ml/hugging-face-vision-trainer commit b24f9186b2

Frequently asked questions

npx skillmds add thedixitjain/hugging-face-vision-trainer