هوش مصنوعی

مدل هوش مصنوعی گفتاری متا با قابلیت تشخیص بیش از 4 هزار زبان متن‌باز شد

متا مدل هوش مصنوعی متفاوتی به نام MMS دارد که می‌تواند در بیش از 1100 زبان تبدیل متن به گفتار داشته باشد.

ایمان صاحبی منتشر شده در 2 خرداد 1402 | 09:30

در دیجیاتو ثبت‌نام کنید

جهت بهره‌مندی و دسترسی به امکانات ویژه و بخش‌های مختلف در دیجیاتو عضو ویژه دیجیاتو شوید.

عضویت در دیجیاتو

تازه‌های تکنولوژی

ویدئوی مرتبط

ویدیو دستاورد تابستان، قطعی برق! | تک‌تاک

متا یک مدل زبانی هوش مصنوعی دارد که تقلیدی از GPT نیست. این شرکت پروژه‌ای به نام «گفتار چندزبانی عظیم» (MMS) را ساخته است که می‌تواند بیش از 4000 زبان را شناسایی کند و در بیش از 1100 زبان تبدیل متن به گفتار داشته باشد.

متا امروز اعلام کرد که پروژه MMS را متن‌باز می‌کند تا به حفظ تنوع زبانی کمک و محققان را به توسعه این زیرساخت‌ها تشویق کند. در بیانیه این شرکت آمده است: «ما امروز به‌صورت عمومی مدل‌ها و کدهای خود را به اشتراک می‌گذاریم تا بقیه افراد جامعه محققان هم بتوانند روی تلاش‌های ما کار کنند. امیدواریم که با این تصمیم مشارکت کوچکی در حفظ تنوع زبانی شگفت‌آور جهان داشته باشیم.»

مدل‌های تشخیص گفتار و تبدیل متن به گفتار معمولاً باید روی هزاران ساعت صدا با برچسب‌گذاری‌های مشخص آموزش داده شوند. این برچسب‌گذاری‌ها برای یادگیری ماشینی بسیار مهم‌اند چون به الگوریتم‌ها اجازه می‌دهند به‌درستی داده‌ها را دسته‌بندی و درک کنند.

بااین‌حال، برای زبان‌هایی که به‌طور گسترده در دنیا استفاده نمی‌شوند و خیلی از آن‌ها در معرض خطر ازبین‌رفتن قرار دارند، متا می‌گوید چنین داده‌هایی وجود ندارند. درنتیجه این شرکت از شیوه‌ای نامتداول برای گردآوری داده‌های صوتی استفاده کرده است.

هوش مصنوعی متا روی چه داده‌هایی آموزش داده شده است؟

متا می‌گوید برای انجام این کار از صداهای ضبط‌شده از ترجمه متن‌های مذهبی بهره گرفته است: «ما به سراغ متن‌های مذهبی نظیر انجیل رفتیم که به بسیاری از زبان‌ها ترجمه شده و ترجمه‌های آن به‌طور گسترده برای تحقیق درزمینه ترجمه از روی متن مورد مطالعه قرار گرفته است. این ترجمه‌ها دارای صداهای ضبط‌شده‌ای از افراد است که آن‌ها را به زبان‌های مختلف خوانده‌اند.» درنتیجه متا با کمک این داده‌ها که البته برچسب‌گذاری نشده بودند، توانست زبان‌های مدل خود را به بیش از 4000 عدد برساند.

READ اپل با یک پروتکل جدید از کاربران iMessage در برابر حملات کوانتومی محافظت می‌کند

غول دنیای فناوری می‌گوید اگرچه منبع آموزش مدل هوش مصنوعی آن‌ها متون مذهبی بوده است، اما این اتفاق باعث نشده که این مدل سوگیری مذهبی پیدا کند. متا ادعا می‌کند که دلیل این عدم سوگیری استفاده از رویکرد «دسته‌بندی زمانی پیوندگرا» (CTC) است که در مقایسه با مدل‌های زبانی بزرگ (LLM) محدودیت‌های بسیار بیشتری دارد.

بااین‌حال، متا یادآور شده است که مدلش بی‌نقص نیست. برای مثال، این مدل می‌تواند در تبدیل گفتار به نوشتار دچار اشتباه شود، اما این شرکت امیدوار است که با کمک جامعه متن‌باز بتواند هرچه بیشتر مدل خود را بهینه‌سازی کند. درکنار ابزار متا، برنامه‌های کاربردی دیگری نیز وجود دارند که از هوش مصنوعی برای ترجمه بسیاری از زبان‌های زنده دنیا بهره می‌برند.

متا

کپی لینک

1 0

ایمان صاحبی

دبیر بخش تکنولوژی

فناوری مخصوصاً بخشی که روی لبه حرکت می‌کنه، جذاب‌ترین قسمت این دنیا برام محسوب می‌شه، اما همه حوزه‌ها حتی نقاط تلاقی علم و فناوری می‌تونن خیلی جذاب باشن. در کنار این‌ها دنیای فیلم، سریال و بازی‌های ویدیویی رو هم دوست دارم.

مشاهده کلیه مقالات منتشر شده