میدجورنی V7
راهنمای کامل میدجورنی V7: ویژگیها، پرامپت و نمونهها
Midjourney AI Team · ۱ مرداد ۱۴۰۵ · 7 min read
Keywords: میدجورنی V7, تولید تصویر هوش مصنوعی
Published: ۱ مرداد ۱۴۰۵ Author: Midjourney AI Team
درک تغییرات در میدجورنی V7
انتشار میدجورنی V7 نقطه عطفی در نحوه مدیریت انسجام و قصد کاربر توسط مدلهای مولد است. نسخههای قبلی اغلب کاربران را مجبور میکردند با تمایل مدل به توهم جزئیات یا نادیده گرفتن محدودیتهای پیچیده بجنگند. V7 این پویایی را با اولویت دادن به پایبندی معنایی بدون فدا کردن تراکم زیباییشناختی که پلتفرم را محبوب کرد، تغییر میدهد. برای حرفهایهایی که هوش مصنوعی را در گردش کار تولید ادغام میکنند، این بهروزرسانی تعداد تکرارهای مورد نیاز برای رسیدن به خروجی نهایی را کاهش میدهد. این فقط یک افزایش کیفیت نیست؛ بلکه یک بازطراحی قابلیت استفاده است که دستورالعمل دقیق را بر آزمایشهای مبهم پاداش میدهد.
وقتی معماری پشت V7 را تحلیل میکنیم، تمرکز از نویز دیفیوژن خالص به نقشهبرداری بهتر فضای نهان تغییر میکند. این بدان معناست که مدل رابطه بین اشیاء در یک صحنه را منطقیتر درک میکند. اگر درخواست «دستی که دوربین را نگه داشته» بدهید، V7 کمتر احتمال دارد انگشتان را با بدنه لنز ادغام کند. این یکپارچگی ساختاری به creators اجازه میدهد زمان کمتری را صرف رفع آناتومی کنند و بیشتر روی نورپردازی و ترکیببندی تمرکز کنند. برای تیمهایی که از استودیو میداس ای آی استفاده میکنند، این قابلیت اطمینان مستقیماً به زمان تحویل سریعتر پیشنویسهای مشتری ترجمه میشود.
ویژگیهای اصلی: جزئیات، معنایی و کنترل
سه ستون V7 تراکم جزئیات، پایبندی معنایی و حساسیت به سبک هستند. تراکم جزئیات در V7 به معنای افزودن نویز برای بافت نیست. در عوض، مدل اطلاعات را جایی که مهم است رندر میکند. منافذ پوست فقط زمانی ظاهر میشوند که فاصله دوربین نشان دهد باید قابل مشاهده باشند. این از «ظاهر پلاستیکی» رایج در نسخههای قبلی جلوگیری میکند که در آن نویز با فرکانس بالا به صورت سراسری اعمال میشد.
پایبندی معنایی حیاتیترین ارتقا برای مهندسان پرامپت است. در V6، جملات پیچیده اغلب باعث میشد مدل سوژههای ثانویه را حذف کند. V7 پایداری سوژه را حتی زمانی که پرامپت شامل چندین بند است حفظ میکند. برای مثال، توصیف همزمان لباس شخصیت، اقدام او و آبوهوای پسزمینه دیگر باعث نمیشود مدل آبوهوا را نادیده بگیرد. این امکان تولید تصویر روایتمحور را به جای پرترههای تکسوژه فراهم میکند.
حساسیت به سبک نیز تنظیم شده است. پارامتر --style raw اکنون با کلمات کلیدی هنری قابلپیشبینیتر تعامل میکند. قبلاً، افزودن «نورپردازی سینمایی» ممکن بود یک سبک هنری خاص مانند «آبرنگ» را لغو کند. در V7، مدل این دستورالعملها را متعادل میکند و اجازه زیباییشناسی ترکیبی میدهد. این برای ثبات برند حیاتی است، جایی که ممکن است به سبک تصویرسازی خاصی نیاز داشته باشید که همچنان الزامات نورپردازی سختگیرانه برای قابلیت مشاهده محصول را رعایت کند.
چارچوب پرامپت چهار لایه
برای به حداکثر رساندن قابلیتهای V7، رویکرد ساختاریافتهای به ساخت پرامپت توصیه میکنیم. انباشتن تصادفی کلمات کلیدی اغلب منجر به سیگنالهای متضاد میشود. ساختار چهار لایه اطمینان حاصل میکند که مدل دستورالعملها را به ترتیب اهمیت پردازش میکند.
لایه ۱: سوژه و اقدام همیشه با تمرکز اصلی شروع کنید. در مورد کاری که سوژه انجام میدهد مشخص باشید.
- ضعیف: یک زن در حال دویدن.
- قوی: یک دونده زن در میانه گام، عضلات منقبض، چشمهای متمرکز بر افق.
لایه ۲: محیط و اتمسفر مشخص کنید اقدام کجا اتفاق میافتد و حالوهوای صحنه چگونه است.
- مثال: روی پیست آسفالت خیس در سپیدهدم، مه برخاسته از زمین، تنهای رنگی آبی خنک.
لایه ۳: سبک و نورپردازی رسانه هنری و منبع نور را مشخص کنید.
- مثال: فیلمبرد شده با فیلم ۳۵ میلیمتری، نورپردازی حجمی، کنتراست بالا، درجهبندی رنگ سینمایی.
لایه ۴: دوربین و پارامترها با مشخصات فنی و فلگهای مدل پایان دهید.
- مثال: لنز ۸۵ میلیمتری، f/1.8 --ar 16:9 --v 7 --style raw
ترکیب این لایهها یک پرامپت قوی ایجاد میکند. دستور زیر را امتحان کنید:
/imagine prompt: A vintage leather armchair in a sunlit library, dust motes dancing in light beams, warm golden hour glow, photorealistic interior design, 50mm lens --ar 3:2 --v 7 --style raw
این ساختار به مدل کمک میکند تا قبل از اعمال فیلترهای سبک، سوژه را اولویتبندی کند. این احتمال غلبه سبک بر موضوع را کاهش میدهد، مشکلی رایج در تکرارهای قبلی.
تسلط بر پارامترها و ترکیبها
پارامترها در V7 متفاوت از V5 یا V6 عمل میکنند. فلگ --v 7 برای دسترسی به وزنهای مدل جدید ضروری است. با این حال، ترکیب آن با --sref (مرجع سبک) و --cref (مرجع شخصیت) بهترین ثبات را برای کارهای سری تولید میکند.
برای خروجی جهانی، با --ar 16:9 برای واید سینمایی یا --ar 4:5 برای پرترههای شبکههای اجتماعی شروع کنید. پارامتر --stylize کنترل میکند که مدل چقدر آزادی هنری داشته باشد. در V7، مقدار stylize پایینتر (مثلاً --s 50) تصویر را به تحتاللفظی پرامپت نزدیکتر نگه میدارد، در حالی که مقادیر بالاتر (مثلاً --s 750) جلوههای تزئینی بیشتری اضافه میکند. برای کارهای تجاری، توصیه میکنیم stylize را متوسط نگه دارید تا خروجی با بریف مطابقت داشته باشد.
هنگام استفاده از --style raw، برخی از تعصبات زیباییشناختی پیشفرض میدجورنی را حذف میکنید. این ایدهآل است وقتی میخواهید تصویر شبیه عکسی گرفته شده توسط انسان باشد تا یک رندر دیجیتال. ترکیب --style raw با پارامترهای دوربین خاص مانند --no (پرامپت منفی) به حذف آثار رایج مانند اندامهای اضافی یا متن تار کمک میکند.
Quick Takeaways
عیبیابی مشکلات رایج V7
حتی با بهبودها، مشکلاتی میتواند پیش بیاید. اگر تصاویر شما بیش از حد صاف به نظر میرسند، ممکن است از --stylize بیش از حد استفاده کنید. سعی کنید آن را کاهش دهید یا --style raw را حذف کنید تا بافت را بازگردانید. اگر مدل بخشی از پرامپت شما را نادیده میگیرد، ترتیب را بررسی کنید. V7 از چپ به راست میخواند، با توکنهای اولیه که وزن بیشتری دارند. عناصر حیاتی را به ابتدای پرامپت منتقل کنید.
یک دام رایج دیگر دستورالعملهای نورپردازی متضاد است. درخواست «نورهای نئونی» و «نور طبیعی خورشید» در همان پرامپت رندر را گیج میکند. یک منبع نور اصلی انتخاب کنید و از توصیفکنندههای ثانویه برای اصلاح آن استفاده کنید، مانند «نور طبیعی خورشید که از تابلوهای نئونی عبور میکند».
ثبات در چندین تولید همچنان چالش هر گردش کار هوش مصنوعی است. برای حفظ ثبات شخصیت، به شدت روی --cref تکیه کنید. یک تصویر مرجع از شخصیت خود آپلود کنید و URL را با فلگ --cref ضمیمه کنید. این ویژگیهای صورت و جزئیات لباس را در ژستها و محیطهای مختلف قفل میکند. برای ثبات سبک، از --sref با یک تصویر برد سبک استفاده کنید تا یک عکس tunggal. این به مدل درک گستردهتری از پالت رنگی و بافتی که میخواهید حفظ کنید میدهد.
ادغام V7 در گردش کار شما
پذیرش V7 نیاز به تنظیم انتظارات شما در مورد تکرار دارد. زیرا مدل سازگارتر است، باید پرامپتهای طولانیتر و توصیفیتری بنویسید تا اینکه به کلمات کلیدی کوتاه تکیه کنید. این تغییر نویسندگان و کارگردانان هنری را که میتوانند چشمانداز خود را به وضوح بیان کنند پاداش میدهد.
برای تیمهایی که چندین پروژه را مدیریت میکنند، سازماندهی پرامپتها با ساختار چهار لایه اطمینان حاصل میکند که هر عضو تیمی میتواند نتایج را تکرار کند. مستندسازی زمانی آسانتر میشود که هر پرامپت از همان منطق پیروی کند. میتوانید این پرامپتهای ساختاریافته را به عنوان قالبها در استودیو میداس ای آی ذخیره کنید تا پروژههای آینده را تسریع بخشید.
بهرهوری حاصل از V7 قابل توجه است. جایی که V5 ممکن است به ده تنوع نیاز داشته باشد تا یک تصویر قابل استفاده پیدا کند، V7 اغلب گزینههای viable را در اولین دسته تحویل میدهد. این به شما اجازه میدهد روی پسپردازش و پالایش تمرکز کنید تا تولید اولیه. برای تجربه این بهبودها از نزدیک، توصیه میکنیم پارامترهای مدل جدید را در یک محیط کنترل شده آزمایش کنید.
آیا آماده بهینهسازی تولید هنر هوش مصنوعی خود هستید؟ قابلیتهای کامل latest model را در پلتفرم یکپارچه ما کاوش کنید.
امتحان میدجورنی در استودیو میداس ای آی
با تسلط بر ظرافتهای V7، از تولید تصادفی به خلق عمدی حرکت میکنید. ابزارها قدرتمندتر هستند، اما دقت بیشتری میطلبند. با پرامپت به عنوان یک بریف رفتار کنید، نه یک لیست آرزو، و مدل با داراییهای در سطح حرفهای پاسخ میدهد که به طور یکپارچه در خط تولید شما جای میگیرند.