اطلاعات فاش شده از یک پایگاه داده جدید نشان میدهد که دولت چین یا نهادی وابسته به دولت در حال استفاده از یک مدل زبانی بزرگ (LLM) برای سانسور گسترده و دقیق محتوای آنلاین است. این سیستم فراتر از روشهای سنتی نظارت، به طور خودکار محتوای حساسی را که مطلوب دولت چین نباشد، شناسایی و علامتگذاری میکند. بر اساس گزارش تککرانچ، این پایگاه داده شامل ۱۳۳ هزار نمونه از محتوای حساس است که برای آموزش یک مدل زبانی بزرگ به کار گرفته شده است.
به گزارش پیوست، در میان محتوای سانسور شده مواردی از جمله اعتراض به فقر در مناطق روستایی چین، گزارشهایی درباره فساد اعضای حزب کمونیست و افشاگریهایی درباره پلیسهای فاسد که از کارآفرینان اخاذی میکنند، به چشم میخورد. اطلاعاتی که از این پایگاه داده به دست آمده به وضوح نشان میدهد که دولت چین به دنبال استفاده از هوش مصنوعی برای بهبود و افزایش کارایی سانسور و کنترل اطلاعات در فضای مجازی و اینترنت است.
شیائو چیانگ، محقق دانشگاه UC Berkeley که در زمینه سانسور چین فعالیت دارد، میگوید این دادهها شواهدی روشنی است که نشان میدهند دولت چین در تلاش برای استفاده از LLMها است تا از آن به عنوان ابزاری کارآمد برای افزایش نظارت و سرکوب دیجیتال کمک بگیرد. او معتقد است که این سیستم جدید، برخلاف روشهای سنتی که به فیلترینگ مبتنی بر کلمات کلیدی و بررسی دستی متکی بودند، دقت و کارایی سانسور را تا حد بالایی افزایش میدهد.
