تاریخ انتشار : ۱۴۰۵/۰۵/۰۵ ساعت ۲۱:۳۸

گروه فرهنگ و هنر: شماری از گزارشها حاکی از آن است که شرکتهای هوش مصنوعی در حال خرید کتابهای قدیمی، اسکن کردن محتوای آنها برای آموزش مدلهایشان و سپس نابود کردن آنها هستند.
برای شرکتهایی که مدلهای زبانی بزرگ (LLM) میسازند، کتابها چیزی جز خوراکی نیستند که باید بهصورت انبوه بلعیده شوند و پس از استخراج اطلاعاتشان، مانند استخوان ماهی دور انداخته شوند. در بسیاری از موارد، آنها ترجیح میدهند از نسخههای دیجیتالی کتابها استفاده کنند یا حتی بهتر از آن، از نسخههای دیجیتالی دزدیشده استفاده کنند. برای مثال، شرکت «متا» به استفاده از کتابهای دیجیتالی غیرقانونی متهم شده و شرکت «آنتروپیک» نیز به دلیل انجام اقدامی مشابه، مجبور شد ۱.۵ میلیارد دلار به نویسندگان غرامت بپردازد.
اما بسیاری از شرکتها، از جمله «آنتروپیک»، به جای نسخههای دیجیتالی، به سراغ کتابهای چاپی رفتهاند؛ چراکه میتوانند تعداد زیادی نسخه دستدوم را با قیمت بسیار پایین خریداری کنند.
«فیوچریسم» نوشت: بر اساس اسناد مرتبط با همان پرونده حقوقی، «آنتروپیک» از یک دستگاه برش هیدرولیکی استفاده میکرد تا صفحات کتابهایی را که از فروشندگان کتاب خریده بود، بهطور مرتب از جلد جدا کند. سپس این صفحات با تجهیزات تصویربرداری صنعتی اسکن میشدند. به بیان دیگر، این شرکت واقعا کتابهای نویسندگان را تکهتکه مسخههای باقیمانده این آثار باشند.
این کتابفروش به «404 Media» گفت: «از نظر شخصی، احساسات دوگانهای نسبت به این موضوع دارم.
از یک طرف، از نظر مالی به نفع من است و باعث میشود موجودی قدیمیای که احتمال فروشش کم بود، از انبار خارج شود. بهخصوص که کتابهای خارجی زیادی در اختیار دارم و برای چنین فروشهایی مناسب هستند. اما از طرف دیگر، با کاربرد نهایی این کتابها موافق نیستم و خوشم نمیآید که کتابهای کمیاب خمیر شوند.»
به نظر میرسد کتابهای قدیمی بیشتری نیز در معرض خطر باشند.
«404 Media» گزارش داده است که کتابفروشان آثار کمیاب در هلند نیز با موجی از سفارشهای عمده روبهرو شدهاند که گمان میکنند از سوی شرکتهای هوش مصنوعی ثبت میشوند، هرچند راهی برای اطمینان قطعی از این موضوع ندارند.
هرچند نشانههای زیادی ممکن است حاکی از آن باشد که یک سفارش عمده متعلق به یک آزمایشگاه هوش مصنوعی است، اما در بیشتر موارد کتابفروشان فقط میتوانند حدس بزنند و هیچ راهی برای اثبات آن ندارند.
برای شرکتهایی که مدلهای زبانی بزرگ (LLM) میسازند، کتابها چیزی جز خوراکی نیستند که باید بهصورت انبوه بلعیده شوند و پس از استخراج اطلاعاتشان، مانند استخوان ماهی دور انداخته شوند. در بسیاری از موارد، آنها ترجیح میدهند از نسخههای دیجیتالی کتابها استفاده کنند یا حتی بهتر از آن، از نسخههای دیجیتالی دزدیشده استفاده کنند. برای مثال، شرکت «متا» به استفاده از کتابهای دیجیتالی غیرقانونی متهم شده و شرکت «آنتروپیک» نیز به دلیل انجام اقدامی مشابه، مجبور شد ۱.۵ میلیارد دلار به نویسندگان غرامت بپردازد.
اما بسیاری از شرکتها، از جمله «آنتروپیک»، به جای نسخههای دیجیتالی، به سراغ کتابهای چاپی رفتهاند؛ چراکه میتوانند تعداد زیادی نسخه دستدوم را با قیمت بسیار پایین خریداری کنند.
«فیوچریسم» نوشت: بر اساس اسناد مرتبط با همان پرونده حقوقی، «آنتروپیک» از یک دستگاه برش هیدرولیکی استفاده میکرد تا صفحات کتابهایی را که از فروشندگان کتاب خریده بود، بهطور مرتب از جلد جدا کند. سپس این صفحات با تجهیزات تصویربرداری صنعتی اسکن میشدند. به بیان دیگر، این شرکت واقعا کتابهای نویسندگان را تکهتکه مسخههای باقیمانده این آثار باشند.
این کتابفروش به «404 Media» گفت: «از نظر شخصی، احساسات دوگانهای نسبت به این موضوع دارم.
از یک طرف، از نظر مالی به نفع من است و باعث میشود موجودی قدیمیای که احتمال فروشش کم بود، از انبار خارج شود. بهخصوص که کتابهای خارجی زیادی در اختیار دارم و برای چنین فروشهایی مناسب هستند. اما از طرف دیگر، با کاربرد نهایی این کتابها موافق نیستم و خوشم نمیآید که کتابهای کمیاب خمیر شوند.»
به نظر میرسد کتابهای قدیمی بیشتری نیز در معرض خطر باشند.
«404 Media» گزارش داده است که کتابفروشان آثار کمیاب در هلند نیز با موجی از سفارشهای عمده روبهرو شدهاند که گمان میکنند از سوی شرکتهای هوش مصنوعی ثبت میشوند، هرچند راهی برای اطمینان قطعی از این موضوع ندارند.
هرچند نشانههای زیادی ممکن است حاکی از آن باشد که یک سفارش عمده متعلق به یک آزمایشگاه هوش مصنوعی است، اما در بیشتر موارد کتابفروشان فقط میتوانند حدس بزنند و هیچ راهی برای اثبات آن ندارند.
