Automatic1111 optimisé pour Apple Metal : +40% de vitesse
Une optimisation d'Automatic1111 pour Apple Metal permet des gains de vitesse significatifs pour Stable Diffusion 1.5. Sur un M3 Pro, les temps de génération passent de 8-10 secondes à 3-7 secondes. L'approche cible spécifiquement les workloads SD 1.x avec des optimisations comme Metal Flash Attention.
« The same class of generation that was taking roughly 8–10 seconds on my M3 Pro is now generally landing between 3 and 7 seconds. » - Hacker News (frontpage)
Que faut-il retenir ?
- Optimisation d'Automatic1111 pour Apple Metal réduit les temps de génération de 40%
- Sur M3 Pro : passage de 8-10 secondes à 3-7 secondes pour les générations courtes
- Implémentation spécifique de Metal Flash Attention pour certaines formes d'attention SD 1.x
- Approche ciblée préservant la compatibilité avec l'écosystème Automatic1111 existant
Pourquoi cette nouvelle compte-t-elle ?
Ces optimisations permettent aux utilisateurs de Stable Diffusion sur Mac d'obtenir des performances significativement améliorées sans changer leur workflow existant. Cela ouvre la voie à une meilleure utilisation des capacités matérielles spécifiques d'Apple Silicon pour l'IA générative, tout en maintenant la compatibilité avec l'écosystème existant de checkpoints et d'extensions.
40% d'amélioration des performances
💬 dmikey, Développeur du fork Automatic1111 pour Apple Metal
Public concerné : développeurs
Comment optimiser Stable Diffusion sur Apple Silicon ?
Le fork Automatic1111 pour Apple Metal utilise des optimisations spécifiques comme Metal Flash Attention pour certaines opérations, permettant jusqu'à 40% de gain de performance tout en conservant la compatibilité avec l'écosystème existant de modèles et d'extensions.