گوگل روی تراشه هوش مصنوعی جدیدی با معماری مدلهای جمینای کار میکند
این تراشه میتواند به ازای هر وات مصرف انرژی، بین ۶ تا ۱۰ برابر بیشتر از جدیدترین نسل واحدهای پردازش تنسور گوگل، توکن پردازش کنند.
طبق گزارشی که اخیراً توسط نشریه The Information و به نقل از دو شخص مطلع منتشر شده، گوگل درحال توسعه یک تراشه سرور با نام غیررسمی «Frozen v2» است که بخشی از معماری مدل جمینای را مستقیماً روی سیلیکون حک میکند. مهندسان این پروژه پیشبینی کردهاند که این تراشه میتواند به ازای هر وات مصرف انرژی، بین ۶ تا ۱۰ برابر بیشتر از جدیدترین نسل واحدهای پردازش تنسور (TPU) گوگل، توکن پردازش کند و زمانبندی عرضه آن برای سال ۲۰۲۸ هدفگذاری شده است. دو منبع آگاه اظهار داشتند که این پروژه واکنشی به کمبود شدید پردازشهای هوش مصنوعی است؛ به طوری که گوگل کلود حتی مجبور شده است قرارداد با مشتریان خارجی را رد کند.
یک TPU، درست مانند پردازشگرهای گرافیکی (GPU)، هر مدلی را که روی آن بارگذاری شود اجرا میکند؛ به این معنا که سختافزار هنگام تعامل با مدل، تصمیمات زمانبری را در حین اجرا (Runtime) اتخاذ میکند. تراشه Frozen v2 برخی از تصمیمات مربوط به جمینای را بهطور ثابت در ترانزیستورها تعبیه کرده و بدین ترتیب تعداد مراحل انجامشده توسط تراشه و حجم دادههای جابهجا شده در هر درخواست را کاهش میدهد. یکی از منابع آگاه گفته این ویژگی میتواند تأخیر پاسخگویی را به اندازه کافی کاهش دهد تا کاربردهای جدیدی امکانپذیر شوند.
طراحی تراشهای هماهنگ با معماری مدلهای هوش مصنوعی جمینای گوگل
طرح اولیه Frozen که توسط «جف دین»، دانشمند ارشد گوگل دیپمایند، رهبری میشد، فراتر میرفت و قصد داشت حتی وزنهای خود مدل جمینای را نیز درون تراشه تعبیه کند. طبق گزارش مذکور، گوگل آن پیشنهاد را کنار گذاشت زیرا سیلیکونی که تنها به یک نسخه از مدل گره خورده باشد، چرخه عمر بسیار کوتاهی خواهد داشت. تراشه Frozen v2 به جای وزنها، معماری را در بر میگیرد و وزنها را قابل بهروزرسانی نگه میدارد، به طوری که تراشه در نسخههای مختلف جمینای قابل استفاده باقی بماند؛ البته مشروط بر اینکه گوگل آنها را بر اساس همان معماری قبلی بسازد.

گوگل برنامهای برای تولید تراشه Frozen v2 در حجمی مشابه TPUها ندارد و این نسل را تا حدی به عنوان یک پروسه آزمایشی برای سیلیکونهای تخصصیتر همزمان با ثبات طراحی مدلها میداند. این تراشه در کنار خط تولید TPU قرار میگیرد و جایگزین آن نخواهد شد؛ خط تولیدی که با معرفی نسل هشتم خود در رویداد Cloud Next در ماه آوریل، به مدلهای مجزای آموزش و استنتاج تقسیم شد. هدفگذاری سال ۲۰۲۸ برای عرضه این تراشه همچنین مصادف با سالی است که گفته شده گوگل قرارداد بستهبندی بیش از ۳ میلیون تراشه TPU را با اینتل منعقد کرده است.
استنتاج سختافزاری در سطح مدل پیش از این نیز در نمونههای نمایشی وجود داشته است. شرکت نوپای «Taalas» مستقر در تورنتو که بیش از ۲۰۰ میلیون دلار سرمایه جذب کرده، در ماه فوریه تراشه HC1 خود را با مدل Llama 3.1 8B راهاندازی کرد. این شرکت ادعا میکند که تراشهاش سرعت اجرای ۱۷,۰۰۰ توکن بر ثانیه را بدون داشتن حافظه HBM روی پکیج ارائه میدهد. در همین حال، انویدیا در ماه دسامبر قراردادی ۲۰ میلیارد دلاری برای دریافت لایسنس فناوری از شرکت Groq منعقد کرد.
گوگل هنوز این پروژه را تأیید نکرده است و سخنگوی این شرکت به The Information گفته که همه پروژهها وارد چرخه تولید نمیشوند.

برای گفتگو با کاربران ثبت نام کنید یا وارد حساب کاربری خود شوید.