News, Fast

Atom Brief

17 thg 7, 2026 · Lưu trữ
Tech

NeMo Automodel của NVIDIA hiện đã tinh chỉnh được các mô hình video và hình ảnh của Diffusers

NeMo Automodel của NVIDIA hiện đã tinh chỉnh được các mô hình video và hình ảnh của Diffusers

NeMo Automodel hỗ trợ FLUX.1, Qwen-Image, Wan và HunyuanVideo, chạy tinh chỉnh toàn bộ và tinh chỉnh LoRA trực tiếp từ các checkpoint của Hugging Face mà không cần chuyển đổi.

  • FLUX.1-dev (12B) đạt tốc độ 35.51 hình ảnh mỗi giây khi tinh chỉnh toàn bộ trên 8 GPU H100.
  • Qwen-Image, mô hình 20B, đạt 41.21 hình ảnh mỗi giây với cùng quy trình tinh chỉnh toàn bộ.
  • FLUX.2-dev (32B) và mô hình video 27B của Wan 2.2 đều có công thức LoRA ở hạng 64.

Vì sao quan trọng: Việc tinh chỉnh một mô hình 32 tỷ tham số vẫn đồng nghĩa với việc phải thuê phần cứng của chính NVIDIA để thực hiện.

Hugging Face blog (NVIDIA/Hugging Face teams) ↗ · 17 thg 7, 202617/7/26