توضیحات
کتاب Build a Text-to-Image Generator (from Scratch) به دنیای هنر دیجیتال و مدلهای مولد نفوذ کرده و نحوه ساخت ابزارهایی مانند DALL-E و Stable Diffusion را از پایه آموزش میدهد. نویسنده دو رویکرد اصلی یعنی ترانسفورمرهای بینایی و مدلهای نفوذ (Diffusion Models) را بررسی کرده و به خواننده کمک میکند تا بفهمد چگونه کلمات به پیکسلهای تصویر تبدیل میشوند.
علاوه بر تولید تصویر، مفاهیمی مانند ویرایش تصویر با دستورات متنی، کپشننویسی خودکار برای تصاویر و دستهبندی بصری نیز در کتاب گنجانده شده است. این منبع برای توسعهدهندگانی که میخواهند وارد حوزه هوش مصنوعی چندوجهی (Multimodal) شوند، یک نقشه راه عملی همراه با دیاگرامهای شفاف و مثالهای کدنویسی ارائه میدهد.
ویژگی های کتاب
- آموزش ساخت و آموزش مدلهای دیفیوژن برای تولید تصاویر با کیفیت بالا.
- بررسی معماری Vision Transformers برای طبقهبندی و درک تصاویر.
- آموزش استفاده از مدل CLIP برای سنجش شباهت میان متن و تصویر.
- تکنیکهای ویرایش تصاویر موجود تنها با استفاده از پرامپتهای متنی.
- آموزش Fine-tune کردن مدلهای بزرگ برای کاربردهای خاص هنری یا صنعتی.
- روشهای تشخیص جعل (Deepfake) با استفاده از ویژگیهای استخراج شده از مدل.
مشخصات کتاب
- ناشر: MANNING
- مدرس / نویسنده: With uansformers
- تعداد صفحات: 361
- تعداد فصل ها: 13
- فرمت: PDF
سرفصلها

تصاویر

راهنمای استفاده
فایل را اکسترکت و با نرم افزار مناسب اجرا کنید.
لینک دانلود
گذرواژه فایل(ها): www.downloadly.ir
حجم فایل
9.7 مگابایت












































