Nextflow Multimodal Generation

Build unified decoder-only transformers for multimodal tasks using 6 trillion interleaved text-image tokens with next-scale prediction for visual content—enabling fast 1024x1024 image generation (5 seconds), image editing, and video generation while rivaling specialized diffusion models.

adu2021 5bdb3ab 8.1 KB Updated

File contents

adu2021/skillxiv/tree/main/skills/skillxiv-v0.0.2-claude-opus-4.6/nextflow-multimodal-generation commit 5bdb3ab6fb

Frequently asked questions

npx skillmds@latest add adu2021/nextflow-multimodal-generation