
مدل آفلاین هوش مصنوعی تصویر ساز Z Image Turbo + راهنمای نصب فارسی
Z Image Turbo یک مدل هوش مصنوعی پیشرفته تولید تصویر از متن (Text-to-Image) است که توسط آزمایشگاه Tongyi شرکت علیبابا توسعه یافته. این مدل با تنها ۶ میلیارد پارامتر، کیفیت تصویر فوقالعاده واقعگرایانه (photorealistic)، پایبندی عالی به پرامپت و رندرینگ دقیق متن (حتی به زبانهای مختلف) ارائه میدهد، در حالی که سرعت تولید تصویر آن بینظیر است. Z-Image-Turbo نسخه بهینهشده و تقطیرشده (distilled) مدل اصلی Z-Image است که فقط با ۸ مرحله (steps) تصویر نهایی را تولید میکند و در بسیاری از بنچمارکها عملکردی برابر یا بهتر از مدلهای تجاری سنگینتر دارد.
این ابزار بهخصوص برای تولیدکنندگان محتوا، طراحان، بازاریابها و کسانی که نیاز به تولید سریع و انبوه تصاویر باکیفیت دارند، ایدهآل است. بدون نیاز به سختافزار بسیار گرانقیمت، روی کارت گرافیکهای معمولی قابل اجراست و در برخی پلتفرمها حتی زیر یک ثانیه زمان برای تولید تصویر نیاز دارد. مهمتر از همه، مدل کاملاً اوپنسورس (لایسنس Apache 2.0) است و استفاده تجاری از آن رایگان میباشد.
ویژگیهای کلیدی Z Image Turbo:
- تولید تصویر با کیفیت سینمایی و واقعگرایانه در فقط ۸ مرحله
- سرعت بسیار بالا (sub-second روی GPUهای حرفهای، چند ثانیه روی GPU مصرفی)
- پشتیبانی عالی از رندرینگ متن داخل تصویر (انگلیسی، چینی و …)
- مصرف حافظه پایین (مناسب کارتهای ۱۶ گیگابایت VRAM و حتی کمتر در برخی تنظیمات)
- قابلیت Image-to-Image، Inpainting و استفاده با ControlNet
- پایبندی بسیار خوب به پرامپت و تنوع بالای سبکها
- کاملاً رایگان و اوپنسورس برای استفاده محلی و تجاری
سیستم مورد نیاز حداقلی و پیشنهادی:
- حداقل: کارت گرافیک ۸ گیگابایت VRAM (مثل RTX 3070/4060 Ti)، رم سیستم ۱۶ گیگابایت، ویندوز/لینوکس
- پیشنهادی برای سرعت خوب: کارت گرافیک ۱۲–۱۶ گیگابایت VRAM (RTX 4070/4080 یا بهتر)، رم ۳۲ گیگابایت
- بهینهترین عملکرد: GPUهای حرفهای مثل H800/A100 (زیر ۱ ثانیه تولید تصویر)
- نکته: با torch bfloat16 و بهینهسازیهای ComfyUI حتی روی ۸ گیگ VRAM هم قابل اجراست (با Sample و Step پایین ).