<!-- mobian-agent-page publisher="dailydev" canonical="https://daily.dev/posts/fine-tune-video-and-image-models-at-scale-with-nvidia-nemo-automodel-and-diffusers-h6czd9etv" -->

---
title: Fine-tune video and image models at scale with NVIDIA...
description: NVIDIA and Hugging Face have integrated NeMo Automodel with the Diffusers library to enable production-grade distributed fine-tuning of diffusion models at...
canonical: https://daily.dev/posts/fine-tune-video-and-image-models-at-scale-with-nvidia-nemo-automodel-and-diffusers-h6czd9etv
twitter:card: summary_large_image
twitter:site: @dailydotdev
og:type: website
og:site_name: daily.dev
og:title: Fine-tune video and image models at scale with NVIDIA NeMo Automodel and 🤗 Diffusers | daily.dev
og:description: NVIDIA and Hugging Face have integrated NeMo Automodel with the Diffusers library to enable production-grade distributed fine-tuning of diffusion models at...
og:url: https://daily.dev/posts/fine-tune-video-and-image-models-at-scale-with-nvidia-nemo-automodel-and-diffusers-h6czd9etv
og:image: https://api.daily.dev/og/posts/H6cZD9ETv.png
og:image:alt: Fine-tune video and image models at scale with NVIDIA NeMo Automodel and 🤗 Diffusers
og:image:width: 1200
og:image:height: 630
og:locale: en
---

[Hugging Face](https://daily.dev/sources/huggingface)

[Read post](https://api.daily.dev/r/H6cZD9ETv)

# [Fine-tune video and image models at scale with NVIDIA NeMo Automodel and 🤗 Diffusers](https://api.daily.dev/r/H6cZD9ETv "Go to post")

NVIDIA and Hugging Face have integrated NeMo Automodel with the Diffusers library to enable production-grade distributed fine-tuning of diffusion models at scale. NeMo Automodel is a PyTorch DTensor-native training library that works natively with any Diffusers-format model on the Hub — no checkpoint conversion required. It supports full fine-tuning and LoRA-style PEFT for models like FLUX.1-dev, Wan 2.1 (1.3B and 14B), HunyuanVideo, and Qwen-Image. Key features include FSDP2, tensor/context/pipeline parallelism, multiresolution bucketed dataloading, and multi-node orchestration. A detailed walkthrough covers pre-encoding datasets, launching training via YAML configs, and generating from fine-tuned checkpoints. Performance benchmarks on 8× H100 GPUs are provided for both text-to-image and text-to-video models. The library is open source under Apache 2.0.

[#deep-learning](/tags/deep-learning "Check all #deep-learning posts")[#diffusion-models](/tags/diffusion-models "Check all #diffusion-models posts")[#lora](/tags/lora "Check all #lora posts")

Jul 17 • 10m read time • From [huggingface.co](https://api.daily.dev/r/H6cZD9ETv "huggingface.co")

[![Post cover image](https://media.daily.dev/image/upload/s--58gMhC4P--/f_auto/v1722860399/public/Placeholder%2012)](https://api.daily.dev/r/H6cZD9ETv "Go to post")

Table of contents

[Table of contents](https://api.daily.dev/r/H6cZD9ETv "Table of contents")[ What is NeMo Automodel?](https://api.daily.dev/r/H6cZD9ETv "What is NeMo Automodel?")[ Supported diffusion models](https://api.daily.dev/r/H6cZD9ETv "Supported diffusion models")[ What this collaboration unlocks](https://api.daily.dev/r/H6cZD9ETv "What this collaboration unlocks")[ A look at the fine-tuning workflow](https://api.daily.dev/r/H6cZD9ETv "A look at the fine-tuning workflow")[ Other Finetuned/LoRA examples](https://api.daily.dev/r/H6cZD9ETv "Other Finetuned/LoRA examples")[ Try it today](https://api.daily.dev/r/H6cZD9ETv "Try it today")[ Coming next: Pythonic recipe APIs](https://api.daily.dev/r/H6cZD9ETv "Coming next: Pythonic recipe APIs")[ Resources](https://api.daily.dev/r/H6cZD9ETv "Resources")

Comment

Bookmark

Copy

![Placeholder image for anonymous user](https://media.daily.dev/image/upload/s--qsFuKGv_--/t_logo,f_auto/public/noProfile)Share your thoughts Post

Share this post

[![Hugging Face's image](https://media.daily.dev/image/upload/t_logo,f_auto/v1/logos/f1f55c67d81a4330acf5b90b26b0c8e1)](https://daily.dev/sources/huggingface)

[Hugging Face](https://daily.dev/sources/huggingface "https://daily.dev/sources/huggingface")

HuggingFace's platform is a resource for developers and researchers working in natural language proc... Read more

660 Followers

•

2.3K Upvotes

#### Would you recommend this post?

Copy link

Slack

WhatsApp

Facebook

X

New Squad

Copy linkShare with your friends

```json
{"@context":"https://schema.org","@graph":[{"@type":"Organization","@id":"https://daily.dev/#organization","name":"daily.dev","url":"https://daily.dev","logo":{"@type":"ImageObject","url":"https://daily.dev/apple-touch-icon.png","width":180,"height":180},"sameAs":["https://twitter.com/dailydotdev","https://github.com/dailydotdev","https://www.linkedin.com/company/daily-dev-ltd"]},{"@type":"WebSite","@id":"https://daily.dev/#website","url":"https://daily.dev","name":"daily.dev","publisher":{"@id":"https://daily.dev/#organization"},"potentialAction":{"@type":"SearchAction","target":{"@type":"EntryPoint","urlTemplate":"https://daily.dev/search?q={search_term_string}"},"query-input":"required name=search_term_string"}}]}
{"@context":"https://schema.org","@type":"TechArticle","headline":"Fine-tune video and image models at scale with NVIDIA NeMo Automodel and 🤗 Diffusers","url":"https://daily.dev/posts/fine-tune-video-and-image-models-at-scale-with-nvidia-nemo-automodel-and-diffusers-h6czd9etv","mainEntityOfPage":{"@type":"WebPage","@id":"https://daily.dev/posts/fine-tune-video-and-image-models-at-scale-with-nvidia-nemo-automodel-and-diffusers-h6czd9etv"},"datePublished":"2026-07-17T15:58:47.555Z","dateModified":"2026-07-17T16:04:31.740Z","description":"NVIDIA and Hugging Face have integrated NeMo Automodel with the Diffusers library to enable production-grade distributed fine-tuning of diffusion models at...","image":"https://media.daily.dev/image/upload/s--58gMhC4P--/f_auto/v1722860399/public/Placeholder%2012","thumbnailUrl":"https://media.daily.dev/image/upload/s--58gMhC4P--/f_auto/v1722860399/public/Placeholder%2012","isAccessibleForFree":true,"articleSection":"Hugging Face","inLanguage":"en","publisher":{"@type":"Organization","name":"daily.dev","url":"https://daily.dev","logo":{"@type":"ImageObject","url":"https://daily.dev/apple-touch-icon.png","width":180,"height":180}},"author":{"@type":"Organization","name":"Hugging Face","logo":"https://media.daily.dev/image/upload/t_logo,f_auto/v1/logos/f1f55c67d81a4330acf5b90b26b0c8e1","url":"https://daily.dev/sources/huggingface"},"commentCount":0,"discussionUrl":"https://daily.dev/posts/fine-tune-video-and-image-models-at-scale-with-nvidia-nemo-automodel-and-diffusers-h6czd9etv","interactionStatistic":[{"@type":"InteractionCounter","interactionType":{"@type":"LikeAction"},"userInteractionCount":0},{"@type":"InteractionCounter","interactionType":{"@type":"CommentAction"},"userInteractionCount":0}],"keywords":"deep-learning,diffusion-models,lora","timeRequired":"PT10M"}
{"@context":"https://schema.org","@type":"BreadcrumbList","itemListElement":[{"@type":"ListItem","position":1,"name":"Home","item":"https://daily.dev"},{"@type":"ListItem","position":2,"name":"Hugging Face","item":"https://daily.dev/sources/huggingface"},{"@type":"ListItem","position":3,"name":"Fine-tune video and image models at scale with NVIDIA NeMo Automodel and 🤗 Diffusers"}]}
```

