دفاع متخصصان حقوق از استفاده متا از کتابهای دزدی دریایی برای هوش مصنوعی لاما
براساس گزارش پايگاه خبري سروش امنيت ، متا استدلال میکند که منبع محتوای دارای حق چاپ، از جمله کتابهای غیرقانونی، به عنوان مواد آموزشی بدون مجوز، استفاده منصفانه است. اکنون، گروهی از اساتید حقوق از موضع این غول فناوری حمایت کردهاند.

به گزارش خبرنگار پايگاه خبري سروش امنيت به نقل از پلیس فتا ،
نویسندگان ریچارد کادری، سارا سیلورمن، و کریستوفر گلدن در ابتدا شکایت دسته جمعی را در 7 ژوئیه 2023 ثبت کردند. نویسندگان ادعا کردند که مدل زبان بزرگ متا، لاما، با کپی کردن و مصرف مقادیر انبوه متن دارای حق چاپ آموزش دیده است.
در ماه فوریه، آنها همچنین شواهد جدیدی را ارائه کردند مبنی بر اینکه متا حداقل 81.7 ترابایت داده را در چندین کتابخانه سایه از طریق سایت Anna’s Archive تورنت کرده است – و گفتند که بزرگی این طرح “حیرت انگیز” است.
گروهی از اساتید حقوق مالکیت فکری اکنون میگویند که اینطور نیست. محققان از هاروارد، اموری، دانشگاه بوستون و دانشگاه سانتا کلارا یک خلاصه دوستانه ارائه کردهاند و از موضع متا حمایت کردهاند.
به عنوان یادآوری، amicus brief یک سند حقوقی است که توسط افراد یا سازمانها ارائه میشود، زیرا آنها در پرونده در حال بررسی منافع دارند، حتی اگر مستقیماً طرف خود پرونده نباشند.
استفاده منصفانه: آیا این فقط کپیبرداری داخلی متا است؟
پس از کشف این واقعیت که متا از بیت تورنت برای دانلود کتابهای غیرقانونی برای استفاده به عنوان مواد آموزشی استفاده میکرد، شاکیان در دعوای دسته جمعی ماه گذشته گفتند که این واضحترین دلیل نقض حق نسخهبرداری است.
نویسندگان نوشتند: «پیامد بحثانگیز این است که برای استفاده منصفانه، اثری که کپی شده است باید به طور قانونی در وهله اول به دست آمده باشد.
متا تاکنون به شدت بر دفاع از استفاده منصفانه تکیه کرده و گفته است که استفاده از مجموعه دادههای در دسترس عموم برای آموزش مدلهای زبان بزرگ (LLM) برای آینده توسعه هوش مصنوعی مولد در ایالات متحده بسیار مهم است و طبق قانون حق چاپ ایالات متحده کاملاً خوب است.
اکنون، چهار استاد برجسته مالکیت فکری گفتند که استفاده متا از کتابهای غیرقانونی واقعاً منصفانه است. با توجه به amicus brief ( PDF )، منبع دادههای آموزشی تا زمانی که برای ایجاد یک محصول جدید و متحول کننده استفاده میشود، تعیین کننده نیست.
اساساً، بحث این است که استفاده از کتابها خارج از هدف اصلی «خواندن» آنها برای ایجاد یک مدل هوش مصنوعی، هدف استفاده را تغییر میدهد. به عبارت دیگر، این کپیبرداری داخلی و استفاده منصفانه است.
استادان همچنین خاطرنشان میکنند که موارد قبلی که استفاده منصفانه انکار میشد، معمولاً در مورد نقض حق نسخهبرداری مربوط به مصرف شخصی بود – نه استفاده از محتوا برای ایجاد چیزی جدید.
برخی از کشورها، مانند ژاپن و سنگاپور، استثناهایی را در قوانین خود ایجاد کردهاند تا به شرکتهای فناوری اجازه دهند بدون مجوز به LLMها در مورد مطالب دارای حق چاپ آموزش دهند.
به عنوان مثال، کیکو ناگوآکا، وزیر آموزش، فرهنگ، ورزش، علم و فناوری ژاپن، در ژانویه اعلام کرد که شرکتهای هوش مصنوعی در ژاپن میتوانند از هر چیزی که میخواهند برای آموزش هوش مصنوعی استفاده کنند صرف نظر از اینکه این کار برای اهداف غیرانتفاعی یا تجاری باشد، خواه این عملی غیر از بازتولید باشد، یا محتوایی که از سایتهای غیرقانونی به دست آمده است یا غیرقانونی.
ایالات متحده چنین استثنایی ندارد، اما در خلاصه خود، اساتید حقوق از دادگاه میخواهند که استفاده منصفانه را در نظر بگیرد. همانطور که VCR و سایر نوآوریها نشان دادند، حق چاپ نباید مانعی برای ابزارهای جدید و فناوری های در حال توسعه باشد.
آنها میگویند: صاحبان کپیرایت اغلب پیشبینی کردهاند که فناوریهای جدید، از فتوکپی گرفته تا ویدئوهای خانگی و اینترنت، فاجعههایی را برای صاحبان حق چاپ ایجاد میکند و استفاده منصفانه برای محافظت از آنها باید کاهش یابد. در عوض، فناوریهای جدید به طور معمول بازارهای جدیدی ایجاد کردهاند.
خطرات هوش مصنوعی هر چه که باشد – و ممکن است بسیار باشد – محکوم کردن اقدام ایجاد مجموعه دادههای آموزشی در مقیاس بزرگ به عنوان نقض حق نسخه برداری راهحلی نیست.
آیا استدلالها آب میخورد؟
البته طرف مقابل – طرف دعوای دسته جمعی – مخالف است و میگوید اشکالات اساسی را میتوان در استدلال اساتید یافت.
پاسکال هتزشولت، مدیر ارشد حفاظت از محتوا در وایلی، ناشر جهانی کتابهای تجاری، کتابهای درسی و تحقیقات علمی، هفته گذشته در وبلاگ خود به توضیح اخیر دادگاه عالی ایالات متحده اشاره کرد که استفاده متحول کننده باید اساساً هدفی متفاوت از هدف اصلی داشته باشد.
Hetzscholdt گفت: مدلهای هوش مصنوعی متا اساساً محصولات تجاری هستند که از آثار دارای حق چاپ برای تولید محتوایی استفاده میکنند که اغلب همان هدفی را که آثار اصلی انجام میدهند، انجام میدهند.
به گفته او، در خلاصه آمیکوس به نحوی ذکر نشده است که مدلهای متا واقعاً تلاشهای آکادمیک یا تحقیقاتی نیستند. برعکس، آنها محصولات تجاری هستند که برای تولید میلیاردها درآمد طراحی شدهاند.
ایمیلهای بدون مهر و موم نشان میدهد که کارمندان متا در مورد خطرات دستگیر شدن صحبت میکنند و به طور فعال پیشنهاد میکنند از VPN برای پنهان کردن فعالیتهای خود استفاده کنند.
هتزشولت گفت، ایمیلهای بدون مهر و موم 2025 نشان میدهند که تیم حقوقی متا مستقیماً در بحثها برای توقف تلاشهای صدور مجوز به نفع استفاده از منابع غیرقانونی دخیل بوده است و به جای استفاده متحول کننده با حسن نیت، بهرهبرداری تجاری عمدی را نشان میدهد.
علاوه بر این، خلاصه amicus نگرانیهای آسیب بازار را رد میکند، اما تحقیقات تجربی مستقیماً با این موضع در تضاد است.
مطالعه برخورد نزدیک: تأثیر دسترسی به دادههای دزدان دریایی بر عملکرد LLM ( PDF ) شواهد ملموسی را ارائه میکند که مدلهای هوش مصنوعی هنگام آموزش آثار دارای حق چاپ، با بهبود عملکرد تا 23 درصد در هنگام استفاده از کتابهای دزدی، عملکرد قابل اندازهگیری بهتری دارند.
این شواهد تجربی ارتباط مستقیمی بین استفاده غیرمجاز از مطالب دارای حق چاپ – در مقیاس وسیع – و مزایای تجاری ایجاد میکند.
در نهایت، Hetzscholdt اشاره میکند که رفتار مستند متا فراتر از دسترسی غیرمجاز است زیرا ایمیلهای غیرمجاز نشان میدهد که کارمندان متا در مورد خطرات دستگیر شدن صحبت میکنند و به طور فعال پیشنهاد میکنند از VPN برای پنهان کردن فعالیتهای خود استفاده کنند.
او نوشت: محاکم به طور مداوم معتقدند که دور زدن عمدی کنترلهای دسترسی و تلاشهای پنهانسازی، ادعاهای استفاده منصفانه را تضعیف میکند.
[author title=”نويسنده” image=”https://soroosheamniyat.ir/wp-content/uploads/2025/03/68ce8398-24e3-40b3-8f1a-cd664029e334.png”]مسعود اسدپور کارشناس امنيت وخبرنگار پايگاه خبري سروش امنيت[/author]
منبع :
پلیس فتا





