اختلال اقتصادی قابلقبول یا فاجعه فرهنگی؟ گزارشی از اعترافات درزکرده از سرقت کتاب توسط اوپنآی

پروندهای که بهتازگی از حالت مهروموم خارج شده، ابعاد تازهای از چالشهای حقوقی و اخلاقی شرکتهای پیشرو هوش مصنوعی را عیان کرده است.
به گزارش اطلاعات آنلاین به نقل از والاستریت ژورنال، اسناد منتشرشده نشان میدهند که مدیران و پژوهشگران ارشد اوپنآی در سالهای نخست توسعه مدلهای چتجیپیتی، آگاهانه و با وجود نگرانیهای جدی درباره ماهیت غیرقانونی منبع، از کتابهای سرقتشده پایگاه داده «لایبری جنسیس» یا همان LibGen برای آموزش هوش مصنوعی استفاده کردهاند.
این افشاگریها در جریان شکایت دستهجمعی نویسندگان نامداری همچون جان گریشام، دیوید بالداچی، جودی پیکولت و جاناتان فرانزن علیه اوپنآی و مایکروسافت مطرح شده است. شاکیان با استناد به این مدارک درونسازمانی، تلاش دارند تا پیش از برگزاری دادگاه رسمی، نظر مساعد قاضی را جلب کنند. در مقابل، شرکتهای فناوری مدافع این رویکرد بوده و استدلال میکنند که بهرهگیری از این محتواها ذیل مفهوم «استفاده منصفانه» قرار میگیرد و جنبه دگرگونکننده دارد؛ توجیهی که نویسندگان و نهادهای صنفی نمیپذیرند.
جزئیات منتشرشده از پیامهای داخلی کارکنان اوپنآی در سال ۲۰۱۹، حاکی از آن است که دیوید لانسکی، مشاور حقوقی وقت شرکت، از پیشنهاددهندگان اصلی استفاده از این کتابخانه رایگان بوده است. با این حال، لحن دیگر اعضای فنی از جمله تام براون و بن مان نسبت به این اقدام کاملاً هشداردهنده بود؛ بهطوریکه آنها منبع مورد نظر را «مشکوک» توصیف کرده بودند. پایگاه LibGen پیشتر نیز بهدلیل انتشار غیرقانونی آثار دارای حق نشر، با احکام قضایی سنگینی از سوی دادگاههای فدرال و ناشران بزرگ علمی روبهرو شده بود.
فشارها و دغدغههای حقوقی درون اوپنآی به حدی بود که تیم پژوهشی تلاش کرد ردی از نام این سایت باقی نگذارد. داریو آمودی، پژوهشگر ارشد وقت اوپنآی و مدیرعامل فعلی شرکت رقیب یعنی آنتروپیک، در پیامرسان داخلی شرکت پرسیده بود که آیا پنهان کردن هویت واقعی پیکرههای داده زیر نامهای مبهمی مانند Books1 و Books2 درست است؟ بن مان نیز تأیید کرده بود که این توضیحات عمداً کلی تنظیم شدهاند تا منبع اصلی یعنی LibGen فاش نشود. بخش قابلتوجهی از مهندسان و محققانی که در آن دوران روی این مدلها کار میکردند، اکنون در شرکت آنتروپیک مشغول به فعالیت هستند.
مدیران اوپنآی از نظر مالی نیز هزینههای خرید قانونی کتاب را بررسی کرده بودند. گرگ بروکمن، رئیس اوپنآی، در اواخر سال ۲۰۲۲ در پاسخی به ایلیا سوتسکور اذعان کرده بود که خرید انبوه کتاب امکانپذیر است، اما به دلیل هزینهبر بودن به ازای هر توکن، در اولویت شرکت قرار نگرفته است. با تشدید حاشیهها و رسانهای شدن موضوع، باب مکگرو، معاون وقت پژوهش اوپنآی، در اواسط سال ۲۰۲۲ دستور داد که برای مصون ماندن شرکت از تبعات حقوقی، دادههای LibGen بهطور کامل از سیستمها و ذخیرهسازیها پاکسازی شود. او تأکید کرده بود که هرچند این کار بازتولید نتایج قبلی را دشوار میکند، اما از نظر حقوقی بسیار ارزشمند است.
فراتر از مساله کپیرایت، این اسناد نشان میدهند که مدیران اوپنآی بهخوبی از پیامدهای اجتماعی فناوری خود آگاه بودهاند. جک کلارک، مدیر سابق سیاستگذاری اوپنآی، در سال ۲۰۲۰ هشدار داده بود که با پیشرفت مدلهای هوش مصنوعی، نویسندگان ژانرهای مختلف نگران جایگزین شدن خود در بازار خواهند شد، اما شرکت ناچار است اعتراضات هنرمندان را نادیده بگیرد. تارون گوگینی، از کارکنان فنی شرکت نیز، موج بیکاری هنرمندان را یک «اختلال اقتصادی قابلقبول» خوانده بود؛ هرچند سام آلتمن بعدها در کنگره ادعا کرد که شرکت تمایلی به جایگزینی خالقان اثر ندارد.
این پرونده تنها به اوپنآی محدود نمیشود. شرکت آنتروپیک نیز سال گذشته مجبور شد برای حلوفصل دعاوی مشابه، توافقی ۱.۵ میلیارد دلاری با نویسندگان امضا کند. با گسترش این چالشها و شکلگیری توافقهای تجاری میان رسانهها و غولهای فناوری، افشای این اسناد بار دیگر بحثهای داغ پیرامون مرز میان نوآوری تکنولوژیک و حقوق مولفان را در عصر هوش مصنوعی داغتر کرده است.




