
به گزارش تجارت نیوز، هوش مصنوعی برای باهوشتر شدن، حالا سراغ یکی از قدیمیترین منابع دانش بشر رفته است: کتاب. شرکتهای فعال در حوزه هوش مصنوعی برای دسترسی به حجم عظیمی از متن باکیفیت، به خرید گسترده کتابهای قدیمی و حتی کمیاب روی آوردهاند؛ کتابهایی که پس از اسکن در برخی موارد دیگر به شکل فیزیکی باقی نمیمانند. این روند هم بازار کتابهای دستدوم را دگرگون کرده و هم نگرانیهایی درباره نابودی بخشی از میراث مکتوب بشر ایجاد کرده است.
ماجرا از نیاز روزافزون مدلهای هوش مصنوعی به داده شروع میشود. اینترنت دیگر منبع بیپایانی از محتوای تازه و باکیفیت نیست و شرکتها برای آموزش مدلهای زبانی قدرتمند، به دنبال متنهایی هستند که ساختار منسجم، زبان انسانی و اطلاعات تخصصی داشته باشند. کتابهای چاپشده، بهخصوص آثار قدیمی که پیش از موج تولید محتوای هوش مصنوعی منتشر شدهاند، برای این شرکتها جذابیت ویژهای دارند؛ زیرا احتمال کمتری دارد خودشان حاصل تولید ماشینی باشند. یک گزارش تحقیقی نیز نشان داده است شرکتهایی برای تهیه کتابهای چاپی از واسطهها استفاده میکنند و حتی درباره مسئله «تصویر عمومی» این خریدها نگرانی وجود دارد.
اما بخش نگرانکننده ماجرا بعد از خرید کتاب آغاز میشود. در روشی که به «اسکن مخرب» یا تخریبی معروف شده، عطف کتاب بریده میشود تا صفحات بتوانند با سرعت بالا وارد دستگاه اسکن شوند. پس از دیجیتالیشدن صفحات، نسخه کاغذی دیگر ارزش اولیه خود را ندارد و ممکن است دور ریخته یا برای بازیافت ارسال شود. برای یک کتاب معمولی شاید این اتفاق چندان مهم به نظر نرسد؛ اما وقتی پای نسخههای کمیاب، چاپهای قدیمی یا کتابهایی به میان میآید که یافتن دوباره آنها دشوار است، ماجرا کاملاً متفاوت میشود.
یکی از مهمترین نمونههای این روند به شرکت آنتروپیک مربوط است. اسناد دادگاه که در سال ۲۰۲۶ منتشر شدند، جزئیاتی از پروژهای محرمانه با نام «پاناما» را آشکار کردند؛ پروژهای که هدف آن خرید و دیجیتالیکردن حجم بسیار بزرگی از کتابهای چاپی برای استفاده در آموزش مدلهای هوش مصنوعی بود. طبق گزارشها، میلیونها کتاب خریداری و صفحات آنها برای اسکن از عطف جدا شدند. اسناد دادگاه نشان میدهند این عملیات در مقیاس بسیار بزرگی دنبال شده بود.
این اتفاق یک تناقض عجیب ایجاد کرده است: …












