دولت دونالد ترامپ، رئیس‌جمهور ایالات متحده، در اقدامی حقوقی و استراتژیک به یک قاضی فدرال اعلام کرده است که شرکت‌های هوش مصنوعی در زمان استفاده از آثار دارای حق تکثیر (کپی‌رایت) برای آموزش مدل‌های زبانی بزرگ خود (LLMs)، مرتکب نقض قانون نشده و اقدام آن‌ها مصداق «استفاده منصفانه» (Fair Use) است.

موضع وزارت دادگستری آمریکا در قبال «استفاده منصفانه»

وزارت دادگستری ایالات متحده (DOJ) روز سه‌شنبه در لایحه‌ای که به دادگاه ارائه کرد، با استناد به چارچوب سیاست‌گذاری کاخ سفید در ماه مارس برای هوش مصنوعی نوشت: «همسو با منافع ملی در جهت ارتقای نوآوری و آزادی بیان، آموزش مدل‌های هوش مصنوعی بر روی مطالب دارای حق تکثیر، به خودی خود قوانین کپی‌رایت را نقض نمی‌کند.»

دولت در این سند تاکید کرده است که مدل‌های زبانی بزرگ در حال حاضر به پژوهشگران در حوزه‌های مختلف برای دستیابی به پیشرفت‌های علمی بزرگ کمک می‌کنند. در ادامه این لایحه آمده است: «محدود کردن توسعه مدل‌های زبانی بزرگ تحت یک برداشت نادرست از دکترین استفاده منصفانه، مانع از این پیشرفت‌های علمی و خلاقانه خواهد شد و به رفاه و پویایی اقتصادی آمریکا آسیب خواهد زد.»

وزارت دادگستری این بیانیه را به قاضی سیدنی استاین (Sidney Stein) در دادگاه منطقه‌ای ایالات متحده ارائه کرده است؛ قاضی پرونده شکایت کپی‌رایت شرکت نیویورک تایمز (The New York Times Co.) و دیگر ناشران علیه شرکت OpenAI.

تمایز میان آموزش مدل‌ها و خروجی‌های کپی‌رایت‌شده

ناشران در این پرونده مدعی هستند که OpenAI حداقل به دو روش حق تکثیر آن‌ها را نقض کرده است: نخست از طریق استفاده از مقالات خبری برای آموزش ChatGPT و دوم با بازتولید بخش‌هایی از این مقالات در خروجی‌هایی که در پاسخ به درخواست‌های کاربران تولید می‌شوند.

با این حال، دولت ترامپ به قاضی استاین استدلال می‌کند که فرآیند جذب و پردازش مقالات توسط یک شرکت هوش مصنوعی برای آموزش، ماهیتی «دگرگون‌ساز» (Transformative) دارد؛ عاملی کلیدی که قضات هنگام ارزیابی دکترین استفاده منصفانه به آن استناد می‌کنند.

وزارت دادگستری در این باره می‌نویسد: «هدف از این کپی‌برداری (ساخت یک مدل هوشمند و تعاملی) با هدف اثر اصلی کپی‌شده (استفاده از زبان برای سرگرم کردن یا آموزش مستقیم مخاطبان خواننده) تفاوت اساسی دارد.»

با این حال، دولت لزوماً خواستار رد کامل شکایت نیست. وزارت دادگستری اشاره کرده است که نمایش مستقیم مقالات در خروجی‌های چت‌بات، در صورتی که اثر اصلی دارای کپی‌رایت را بازسازی و منتشر کند، ممکن است دگرگون‌ساز تلقی نشود.

علاوه بر این، دولت استدلال می‌کند که استفاده از مطالب دارای کپی‌رایت برای آموزش، به خودی خود بازار آثار اصلی را تضعیف نمی‌کند: «آموزش مدل هیچ چیزی را برای عموم فاش نمی‌کند؛ بلکه صرفاً یک نسخه از اثر تحت حفاظت ایجاد می‌کند تا به مدل زبانی بزرگ بیاموزد روابط میان داده‌ها را تشخیص داده و با اطلاعات جدید سازگار شود. پتانسیل خروجی‌های آینده که ممکن است به بازار آسیب برسانند، در ارزیابی فرآیند آموزش مدل ارتباطی ندارد.»

واکنش نیویورک تایمز و سوابق قضایی مشابه

در واکنش به این اقدام، سخنگوی نیویورک تایمز اعلام کرد که دولت «به قیمت آسیب به شمار بی‌شماری از خالقان آثار آمریکایی که آثارشان به سرقت رفته، در کنار چند شرکت تریلیون دلاری هوش مصنوعی ایستاده است.»

سخنگوی این روزنامه افزود: «هم هوش مصنوعی و هم خالقان آثار می‌توانند شکوفا شوند؛ شرکت‌های هوش مصنوعی صرفاً باید هزینه عادلانه‌ای برای محتوایی که محصولاتشان را ممکن می‌سازد پرداخت کنند، همان‌طور که قانون کپی‌رایت ایجاب می‌کند. پیشنهاد دولت برای اجازه دادن به شرکت‌ها جهت برداشتن این محتوا بدون اجازه یا پرداخت غرامت، پایداری محتوای خلق‌شده توسط انسان را که جامعه‌ای سالم به آن وابسته است و هوش مصنوعی برای فعالیت به آن نیاز دارد، از بین می‌برد.»

تا به امروز، دو قاضی فدرال دیگر درباره اینکه آیا استفاده از مطالب دارای کپی‌رایت برای آموزش مدل‌های زبانی بزرگ حقوق نویسندگان را نقض می‌کند یا خیر، اظهار نظر کرده‌اند.

در یک پرونده، قاضی ویلیام الساپ (William Alsup) در منطقه شمالی کالیفرنیا حکم داد که شرکت هوش مصنوعی Anthropic با دیجیتالی کردن کتاب‌هایی که خریداری کرده بود و سپس استفاده از آن‌ها برای آموزش چت‌بات Claude، کپی‌رایت را نقض نکرده است. الساپ سال گذشته نوشت: «استفاده از کتاب‌های مورد بحث برای آموزش کلود و نسخه‌های پیشین آن به شدت دگرگون‌ساز و مصداق استفاده منصفانه بوده است.» البته او در مورد اتهام دانلود میلیون‌ها کتاب کپی‌رایت‌شده غیرقانونی علیه Anthropic موضع نگرفت و با شاکیان همسو شد. شرکت Anthropic بعداً با پرداخت ۱.۵ میلیارد دلار غرامت به نویسندگان موافقت کرد.

در پرونده‌ای دیگر، قاضی وینس چابریا (Vince Chhabria) در منطقه شمالی کالیفرنیا اعلام کرد که کپی‌برداری از مطالب برای آموزش هوش مصنوعی مولد احتمالاً در بیشتر مواقع غیرقانونی خواهد بود. چابریا گفت اگرچه استفاده از کتاب‌ها برای آموزش مدل‌ها دگرگون‌ساز است، اما احتمالاً در اکثر موارد حق تکثیر را نقض می‌کند زیرا هوش مصنوعی مولد این پتانسیل را دارد که بازار را با حجم بی‌پایانی از تصاویر، آهنگ‌ها، مقالات، کتاب‌ها و موارد دیگر اشباع کند. وزارت دادگستری در لایحه جدید خود از رای چابریا انتقاد کرده و نوشته است که این تصمیم «اصول کپی‌رایت را به اشتباه تفسیر کرده است.»