با وجود انتقاداتی مبنی بر اینکه Llama 2 به اندازه کافی باز نیست، گروه تحقیقاتی هوش مصنوعی Meta می خواهد مدل ها را به صورت رایگان منتشر کند تا مجوزهای منبع باز را تغییر دهد.
به گزارش TechNock، در ماه جولای، مرکز تحقیقات بنیادی در هوش مصنوعی (FAIR) Meta مدل زبان بزرگ خود Llama 2 را منتشر کرد که نسبتاً باز و رایگان است و آن را در تضاد با رقبای اصلی خود قرار می دهد. با این حال، در دنیای نرم افزارهای متن باز، شفافیت این شرکت همچنان توسط برخی مثبت تلقی می شود.
نوشته شده توسط لبهاگرچه metalicense Llama 2 را برای بسیاری از افراد رایگان می کند، اما همچنان یک مجوز محدود است که همه الزامات Open Source Initiative (OSI) را برآورده نمی کند. همانطور که در تعریف OSI از منبع باز بیان شد، منبع باز چیزی بیش از اشتراک گذاری کد یا نتایج تحقیقاتی است.
در واقع، منبع باز باید توزیع مجدد رایگان، دسترسی به کد منبع، اجازه ایجاد تغییرات و استقلال از یک محصول خاص را فراهم کند. محدودیت های متا شامل نیاز به هزینه مجوز برای توسعه دهندگان با بیش از 700 میلیون کاربر روزانه و ممنوعیت آموزش سایر مدل ها در Llama است.
IEEE Spectrum نوشت، محققان دانشگاه رادبود در هلند معتقدند ادعای متا مبنی بر متن باز بودن Llama 2 گمراه کننده است و پست های رسانه های اجتماعی این سوال را مطرح کرده اند که متا چگونه می تواند ادعای منبع باز خود را مطرح کند.
جوئل پینو، مدیر مرکز تحقیقات بنیادی در هوش مصنوعی (FAIR) و معاون تحقیقات هوش مصنوعی META، از محدودیت های باز بودن META آگاه است. با این حال، او معتقد است که این تعادل ضروری بین مزایای اشتراک گذاری اطلاعات و هزینه های بالقوه کسب و کار متا است.
بخش هوش مصنوعی متا در گذشته روی پروژه های باز دیگری کار کرده است
یکی از ابتکارات کلیدی متن باز متا، پروژه PyTorch است، یک زبان برنامه نویسی یادگیری ماشین برای توسعه مدل های مولد برای هوش مصنوعی. در سال 2016، این شرکت PyTorch را در دسترس جامعه منبع باز قرار داد. پینو امیدوار است که بر روی همان شور و شوق برای مدل های هوش مصنوعی مولد خود ایجاد کند. به خصوص از آنجایی که PyTorch از زمان انتشار خود به عنوان منبع باز راه زیادی را پیموده است.
برای FAIR مهم است که گروه متنوعی از محققان بتوانند تحقیقات خود را برای دریافت بازخورد بهتر ببینند. متا هنگام اعلام انتشار Llama 2 از همین اخلاق استفاده کرد و این داستان را ایجاد کرد که شرکت معتقد است نوآوری در هوش مصنوعی مولد باید مشارکتی باشد.
پینو میگوید متا در گروههای صنعتی مانند Partnership on AI و MLCommons فعال است تا به توسعه مدلها و دستورالعملهای اساسی برای استفاده ایمن از مدلها کمک کند. این شرکت ترجیح می دهد با گروه های صنعتی کار کند. زیرا او معتقد است که هیچ شرکتی نمی تواند بحث در مورد هوش مصنوعی ایمن و مسئولانه را در جامعه منبع باز رهبری کند.
به نظر می رسد رویکرد متا به باز بودن در دنیای شرکت های بزرگ هوش مصنوعی نوآورانه باشد. OpenAI به عنوان یک شرکت منبع باز با تحقیقات باز شروع به کار کرد. اما Ilya Sotskur، یکی از بنیانگذاران و محقق اصلی OpenAI، به The Verge گفت که به اشتراک گذاری تحقیقات آنها اشتباه است و دلایل رقابتی و امنیتی را ذکر کرد. در حالی که گوگل گهگاه مقالاتی را از دانشمندان خود منتشر می کند، این شرکت همچنین در مورد توسعه برخی از مدل های زبان اصلی خود سختگیر است.
به طور کلی، بازیگران منبع باز در این صنعت، توسعه دهندگان کوچکتری مانند Stability AI و EleutherAI هستند که در فضای تجاری موفقیت هایی داشته اند. توسعه دهندگان متن باز به طور منظم مدل های زبان جدید مهمی را در مخازن کد Hugging Face و GitHub منتشر می کنند. فالکون، یک مدل زبان منبع باز اصلی از موسسه نوآوری فناوری مستقر در دبی، نیز در حال افزایش محبوبیت است و با Llama 2 و GPT-4 رقابت می کند.
با این حال، شایان ذکر است که اکثر ارائه دهندگان بسته هوش مصنوعی جزئیاتی را در مورد نحوه جمع آوری داده ها برای ایجاد مجموعه داده های آموزشی مدل های خود فاش نمی کنند.
متا هم همینطور
پینو میگوید سیستمهای مجوز فعلی برای کار با نرمافزار (مانند بسیاری از سرویسهای هوش مصنوعی مولد) که حجم عظیمی از دادههای خارجی را دریافت میکنند، طراحی نشدهاند. اکثر مجوزها، چه منبع باز و چه اختصاصی، مسئولیت محدودی را برای کاربران و توسعه دهندگان و جریمه های بسیار محدودی را برای تخلف در نظر می گیرند.
با این حال، پینو میگوید مدلهای هوش مصنوعی مانند Llama 2 حاوی حجم بیشتری از دادههای آموزشی هستند و کاربران ممکن است در صورت تولید محتوایی که نقضکننده حقوق است، با مسئولیت بیشتری مواجه شوند. در حال حاضر، نسل فعلی مجوزهای نرم افزاری این موضوع را پوشش نمی دهد.
استفانو مافولی، مدیر عامل OSI نیز به The Verge گفت که این گروه درک می کند که مجوزهای تایید شده OSI ممکن است الزامات خاصی را برای مدل های هوش مصنوعی برآورده نکنند. او می گوید که OSI در حال بررسی نحوه کار با توسعه دهندگان هوش مصنوعی برای ارائه دسترسی آزاد، نامحدود و در عین حال ایمن به مدل ها است.
مافولی می گوید:
ضروری است که مجوزها را بازبینی کنیم تا محدودیتهای واقعی حقوق انتشار و مجوزها در مدلهای هوش مصنوعی را منعکس کنیم. ضمن حفظ بسیاری از اصول جامعه منبع باز.
OSI همچنین تعریفی از منبع باز در رابطه با هوش مصنوعی ارائه می دهد. هر زمان که سؤال «آیا Llama 2 واقعاً منبع باز است؟» پیش میآید. آگاه باشید که این تنها معیار ممکن برای باز بودن نیست. به عنوان مثال، یک گزارش جدید از دانشگاه استنفورد نشان داد که هیچ یک از شرکتهای برتر که از مدلهای هوش مصنوعی استفاده میکنند، به اندازه کافی در مورد خطرات احتمالی و ایمنی در صورت بروز مشکل صحبت نمیکنند. شناسایی ریسکهای بالقوه و فراهم کردن فرصتهایی برای بازخورد لزوماً بخشی استاندارد از بحث منبع باز نیست. اما برای هر کسی که یک مدل هوش مصنوعی توسعه می دهد، باید یک قانون مهم باشد.
پست “متا می خواهد مجوزهای منبع باز را تغییر دهد” اولین بار در TechNock – Tech World News ظاهر شد. ظاهر شد.