Hello ! La semaine commence avec un vrai cadeau pour les habitués de ComfyUI : Alibaba vient de lâcher Qwen-Image 2.1, poids et code compris. Un seul modèle pour générer et éditer, et ça tourne sur ta carte perso !

Qwen-Image 2.1 débarque en local

Ça y est : l'équipe Qwen d'Alibaba a mis en ligne Qwen-Image 2.1, poids et code inclus, sur Hugging Face, GitHub et ModelScope. La grande idée : un seul modèle pour deux usages. Générer une image à partir d'un prompt, et éditer une image existante en la prenant comme référence. Et bonne nouvelle, il est plus léger que la v1 (7,1 milliards de paramètres contre 20), tout en visant plus haut.

Côté matériel, ça rend le modèle plus accessible qu'attendu : une RTX 4090 sort une image en 1024×1024 en ~19 secondes, et ça tourne même sur une 3090. Bon, après, le 2K, lui, est nettement plus gourmand. Il faudra probablement attendre les versions quantifiées pour aller en 2048×2048 natif sur des GPU grand public.

Ce ci dit, le modèle de base est déjà, dès le jour de la sortie, compatible et disponible dans ComfyUI, Diffusers, vLLM et SGLang. Autrement dit, tu peux tester dès maintenant.

⚠️ Le hic à ne pas zapper : contrairement aux versions précédentes (en Apache 2.0), cette 2.1 sort sous une licence non commerciale. Poids ouverts, oui ; open source, non. Pour expérimenter, apprendre et créer à titre perso, tu es tranquille. Mais si tu comptes bâtir un produit dessus, lis bien la licence avant, pas après.

🗞 Autres Articles et News

Continuer la lecture

View more
caret-right