ثبت بازخورد

لطفا میزان رضایت خود را از دیجیاتو انتخاب کنید.

Very satisfied Satisfied Neutral Dissatisfied Very dissatisfied
واقعا راضی‌ام
اصلا راضی نیستم
چطور میتوانیم تجربه بهتری برای شما بسازیم؟

نظر شما با موفقیت ثبت شد.

از اینکه ما را در توسعه بهتر و هدفمند‌تر دیجیاتو همراهی می‌کنید
از شما سپاسگزاریم.

معرفی Nano Banana 2.1
هوش مصنوعی

گوگل از Nano Banana 2.1 رونمایی کرد؛ خلق تصاویر 4K با نصف قیمت

گوگل در این مدل امکان حفظ همزمان چهره افراد و فرم اشیا را در سراسر دستورهای پیاپی ویرایش تصویر فراهم کرد.

جواد تاجی
جواد تاجی منتشر شده در 15 مهر 1405  |  09:03

در دیجیاتو ثبت‌نام کنید

جهت بهره‌مندی و دسترسی به امکانات ویژه و بخش‌های مختلف در دیجیاتو عضو ویژه دیجیاتو شوید.

عضویت در دیجیاتو

گوگل رسماً از جدیدترین مدل تولید و ویرایش تصویر خود با نام Nano Banana 2.1 رونمایی کرد. این مدل که بر پایه جمینای ۳.۶ فلش توسعه یافته است، وضوح تصویر 4K، ردیابی همزمان تا ۱۴ تصویر مرجع و دقت مبتنی بر اتصال به موتور جستجو را به اپلیکیشن جمینای، موتور جستجوی گوگل، بسترهای تبلیغاتی گوگل ادز و پلتفرم‌های توسعه‌دهندگان از جمله استودیو هوش مصنوعی گوگل (Google AI Studio)، فلو (Flow)، استیچ (Stitch) و بسترهای سازمانی جمینای می‌آورد. عرضه این به‌روزرسانی درحال‌حاضر به‌صورت مرحله‌ای برای کاربران این سرویس‌ها آغاز شده است.

بهبود پایداری سوژه و ویرایش 4K با مدل هوش مصنوعی Nano Banana 2.1

مدل جدید نانو بنانا ۲.۱ با هدف رفع بزرگ‌ترین باگ‌ها و مشکلات کلافه‌کننده در دنیای هوش مصنوعی عرضه شده است. این مدل ظرفیت پردازش فوق‌العاده بالایی دارد و می‌تواند دستورها و فایل‌های بسیار حجیم (تا سقف ۱ میلیون توکن) را یک‌جا تحلیل کند. به‌لطف این توان پردازشی، کاربران می‌توانند تصاویری با وضوح استاندارد 1K و 2K تا کیفیت بسیار شفاف 4K را در نسبت‌های ابعادی گوناگون (از تصاویر مربعی گرفته تا کادرهای فوق‌عریض پانوراما) تحویل بگیرند. همچنین برای ویرایش، امکان آپلود مستقیم تصاویر تا ۷ مگابایت و بارگذاری فایل‌ها از فضای ابری تا حجم ۳۰ مگابایت فراهم شده است؛ به‌طوری‌که سیستم به‌ازای پردازش و آنالیز هر تصویر ورودی، تنها حدود ۱,۱۲۰ واحد پردازشی (توکن) مصرف می‌کند.

در فرایندهای ویرایش چندمرحله‌ای، Nano Banana 2.1 توانایی آن را دارد که حداکثر ۱۴ تصویر مرجع را به‌صورت همزمان دریافت کرده و تا ۴ کاراکتر و ۱۰ شیء مختلف را ردیابی و حفظ کند. این قابلیت حیاتی مانع از تغییر شکل چهره افراد یا فرم اشیا در پرامپت‌های پیاپی می‌شود و ظاهر آنها را ثابت نگه می‌دارد. علاوه‌براین، توسعه‌دهندگان می‌توانند میزان سطح تفکر تحلیلی مدل را تنظیم کرده و با فعال‌سازی اعتبارسنجی از طریق موتور جستجوی متنی و تصویری گوگل، جزئیات دنیای واقعی را پیش از تصویرسازی نهایی به‌دقت راستی‌آزمایی کنند.

علاوه‌بر تغییرات فنی، مهم‌ترین خبر برای توسعه‌دهندگان کاهش شدید هزینه‌ها است. گوگل تعرفه استفاده از توکن‌های تصویر این مدل را در سرویس‌های خود با ۵۰ درصد تخفیف به ۳۰.۰۰ دلار به ازای هر ۱ میلیون توکن تصویر کاهش داده است که نصف نرخ قبلی ۶۰.۰۰ دلاری محسوب می‌شود. نرخ ورودی متنی معادل ۱.۵۰ دلار به ازای هر ۱ میلیون توکن و خروجی متنی یا تحلیلی نیز ۷.۵۰ دلار به‌ازای هر ۱ میلیون توکن تعیین شده است. در زمینه تولید مستقیم تصویر، این قیمت‌ها به معنای هزینه ۰.۰۳۳۶ دلاری برای هر تصویر با وضوح 1K (کاهش از ۰.۰۶۷ دلار)، ۰.۰۵۰۴ دلار برای وضوح 2K و ۰.۰۷۵۶ دلار برای کیفیت 4K (کاهش از ۰.۱۵۱ دلار) خواهد بود.

پردازش‌های دسته‌ای این مدل نیز شامل تخفیف ۵۰ درصدی مضاعف می‌شوند که در این صورت هزینه هر تصویر 1K تا ۰.۰۱۶۸ دلار کاهش پیدا می‌کند. مدل Nano Banana 2.1 همچنین به فناوری تأیید اصالت محتوا برای ردیابی منشأ دیجیتالی آثار مجهز شده است، هرچند براساس مستندات سازمانی، تولید چهره افراد واقعی روی نسخه پلتفرم سازمانی این مدل همچنان مجاز نخواهد بود.

جواد تاجی
جواد تاجی

دوران حرفه‌ای من در دنیای فناوری تقریبا به ۱۰ سال قبل برمی‌گرده؛ مسیری که با سخت‌افزار شروع شد، با نرم‌افزار ادامه پیدا کرد و حالا با خبرنگاری حوزه فناوری توی دیجیاتو داره ادامه پیدا می‌کنه. من جوادم و بیشتر از سه دهه از عمرم می‌گذره و علاوه بر دنیای فناوری عاشق فیلم‌و‌سینما، موسیقی کلاسیک‌راک و رئال مادریدم.

دیدگاه‌ها و نظرات خود را بنویسید
    مطالب پیشنهادی