چهارشنبه 26 شهریور 1404 – 13:05
تکناک
یکی از چالشهای اصلی مدلهای زبانی بزرگ (LLM) استفاده از دادههای حساس کاربران در فرایند آموزش است. این مدلها در برخی موارد ممکن است بخشهایی از دادههای آموزشی خود را بدون تغییر بازگو کنند؛ مسئلهای که در صورت وجود اطلاعات شخصی یا محتوای دارای حق نشر، خطر نقض حریم خصوصی یا بروز مشکلات حقوقی را در پی دارد. شرکت گوگل برای جلوگیری از چنین اتفاقی، با افزودن نویز کنترلشده در مرحله آموزش تلاش کرده است تا مانع «حفظ شدن» دادهها در حافظه مدل شود.
به گفته گوگل، مدل زبانی بزرگ VaultGemma فعلاً یک پروژه آزمایشی است، اما میتواند مبنای توسعه نسل جدید مدلهای زبانی با محوریت امنیت و حریم خصوصی باشد. این مدل اکنون با وزنهای باز (Open Weights) از طریق Hugging Face و Kaggle در دسترس پژوهشگران و توسعهدهندگان قرار گرفته است. با وجود این، مانند دیگر مدلهای خانواده Gemma، کاملاً متنباز نیست و کاربران ملزم به رعایت شرایط مجوز گوگل هستند.
برای مشاهده کامل مطب کلیک کنید
