Sony Music Publishing، Warner Chappell Music و ناشران وابسته در ۲۸ اوت شکایت تازه‌ای درباره حق نشر علیه Anthropic، مدیرعامل آن Dario Amodei و هم‌بنیان‌گذار Benjamin Mann در دادگاه فدرال ناحیه شمالی کالیفرنیا ثبت کردند. این پرونده فشار حقوقی بر سازنده Claude را از اختلاف‌های مربوط به خروجی مدل و کتاب‌ها به نحوه تهیه و استفاده از آثار موسیقایی در داده‌های آموزشی گسترش می‌دهد.

برای شرکت‌های AI و سازمان‌هایی که روی مدل‌های پایه محصول می‌سازند، مسئله عملی provenance است. شکایت ادعا می‌کند آثار دارای حق نشر از طریق torrent، scraping و download به دست آمده و سپس در سامانه‌هایی که برای توسعه Claude استفاده شده‌اند کپی شده‌اند. این ادعاها در این پرونده هنوز اثبات نشده‌اند. با این حال، دعوا دوباره مسیر تهیه داده آموزشی را، نه فقط خروجی بعدی مدل، در مرکز یک اختلاف بزرگ کپی‌رایت قرار می‌دهد.

گروه تازه‌ای از ناشران مسیر تهیه داده را هدف گرفته‌اند

شاکیان شامل شرکت‌های Sony Music Publishing، Warner Chappell Music و ناشران مرتبط هستند. شکایت Anthropic، Amodei و Mann را به‌عنوان خوانده معرفی می‌کند و درخواست محاکمه با هیئت منصفه دارد. چهار محور حقوقی مطرح شده است: نقض مستقیم مرتبط با torrenting ادعایی، مشارکت در نقض علیه دو بنیان‌گذار، نقض مستقیم توسط Anthropic و حذف یا تغییر اطلاعات مدیریت حق نشر.

پرونده مجموعه‌ای از آثار موسیقایی تحت کنترل ناشران را فهرست می‌کند و ادعا دارد Anthropic حجم بزرگی از محتوای محافظت‌شده را برای آموزش و بهره‌برداری Claude تهیه و کپی کرده است. TechCrunch گزارش کرده ناشران این رفتار را یک عملیات گسترده تهیه غیرمجاز توصیف می‌کنند و Anthropic پیش از انتشار گزارش پاسخی ارائه نکرده بود.

وضعیت حقوقی باید دقیق دیده شود. complaint مجموعه‌ای از ادعاهاست، نه حکم دادگاه. ناشران همچنان باید اعمال مورد ادعا، مالکیت، کپی‌برداری و سایر عناصر لازم را اثبات کنند و Anthropic می‌تواند هم واقعیت‌ها و هم نظریه‌های حقوقی را به چالش بکشد.

پرونده میان استفاده برای training و نحوه دستیابی به داده فرق می‌گذارد

اهمیت این دعوا در این است که دادگاه‌های آمریکا بیش از گذشته دو سؤال را از هم جدا می‌کنند: آیا استفاده از اثر دارای حق نشر برای training تحت یک استدلال حقوقی مشخص مجاز است، و آیا نسخه‌ای که برای training استفاده شده از مسیر قانونی تهیه شده است یا نه.

شکایت جدید بر همین تمایز تکیه دارد و به litigation قبلی Anthropic اشاره می‌کند. TechCrunch توضیح می‌دهد که در پرونده نویسندگان Bartz، قاضی فدرال training مدل و تهیه نسخه‌های pirated را به‌صورت متفاوت بررسی کرد. دعوای ناشران موسیقی تلاش می‌کند مسیر تهیه داده را به منبع اصلی مسئولیت تبدیل کند.

این تمایز برای AI governance پیام مستقیم دارد. ممکن است یک ارائه‌دهنده مدل policy قابل دفاعی درباره استفاده از مدل داشته باشد، اما اگر نتواند نشان دهد نسخه‌های training از کجا آمده‌اند، چه licenseهایی داشته‌اند، چه نسخه‌هایی نگهداری شده‌اند و چگونه وارد pipeline شده‌اند، همچنان با ریسک جداگانه روبه‌رو شود.

برای مشتریان enterprise نیز موضوع به supplier risk تبدیل می‌شود. مشتری معمولاً corpus کامل training یک frontier model را نمی‌بیند، اما می‌تواند از vendor درباره provenance control، مستندات منابع licensed یا authorized، retention policy، فرایند رسیدگی به dispute و تخصیص قراردادی ریسک مالکیت فکری سؤال کند.

Music publishing ساختار حقوقی متفاوتی دارد

حقوق موسیقی از نظر عملی پیچیده است، زیرا یک ترانه ضبط‌شده می‌تواند حقوق جداگانه‌ای برای sound recording و composition داشته باشد. شاکیان فعلی ناشرانی هستند که بر حقوق composition تمرکز دارند. بنابراین موضوع فقط یک ادعای عمومی درباره متن scrape شده از وب نیست.

Music Business Worldwide گزارش کرده که بازوهای نشر Sony و Warner در میان شاکیان هستند و این پرونده در کنار سایر litigationهای صنعت موسیقی علیه Anthropic قرار می‌گیرد. خود complaint نیز تعداد زیادی publisher و آثاری را معرفی می‌کند که بنا بر ادعای شاکیان در توسعه مدل کپی شده‌اند.

معنای این خبر این نیست که هر استفاده موسیقایی از AI غیرقانونی است. مسئله این است که training-data system باید حقوق را در همان سطحی مدل کند که واقعاً وجود دارند. یک فایل ممکن است از نظر فنی قابل دسترس باشد، اما همچنان محدودیت licensing، قلمرو، قرارداد یا copyright داشته باشد که crawler نمی‌بیند.

تیم‌های AI چه چیزی باید از این پرونده بگیرند

نتیجه حقوقی هنوز نامعلوم است، اما درس engineering و governance روشن است. provenance داده آموزشی باید یک کنترل درجه‌یک باشد و بتواند پاسخ دهد artifact را چه کسی تأمین کرده، چگونه تهیه شده، چه حقوقی برای آن اعلام شده، چه transformationهایی روی آن انجام شده و در کدام training run استفاده شده است.

تیم‌ها باید evidence مربوط به source acquisition را از evidence مربوط به model behavior جدا کنند. output filter، memorization test و takedown process یک دسته ریسک را پوشش می‌دهند، اما قانونی بودن تهیه نسخه‌های underlying را ثابت نمی‌کنند.

این پرونده ارزش dataset lineage را نیز بیشتر می‌کند. اگر origin metadata در ابتدای preprocessing حذف شود، audit بعدی بسیار دشوارتر خواهد شد. همین مسئله برای datasetهای third-party و data brokerها نیز وجود دارد: تضمین قراردادی مفید است، اما وقتی داده وارد asset اصلی مدل می‌شود auditability همچنان لازم است.

چه چیزهایی هنوز حل نشده‌اند

ناشران damages، injunction، نابودی نسخه‌های مورد ادعا و برخی remedyهای حسابرسی و disclosure را می‌خواهند. اندازه مسئولیت احتمالی را نمی‌توان از complaint به‌تنهایی نتیجه گرفت. تعداد آثاری که نهایتاً واجد شرایط شناخته شوند، statutory damages، مسئولیت افراد و رابطه این پرونده با دعاوی دیگر همگی محل اختلاف خواهند بود.

پاسخ Anthropic مهم است، زیرا record عمومی فعلاً عمدتاً از ادعاهای شاکیان تشکیل شده است. بنابراین نتیجه قابل اتکا در این مرحله محدودتر از زبان تند complaint است: Sony Music Publishing و Warner Chappell جبهه تازه و مهمی در litigation کپی‌رایت Anthropic باز کرده‌اند و بار دیگر data acquisition و provenance را به یک مسئله governance برای توسعه‌دهندگان مدل تبدیل کرده‌اند، نه یک کار صرفاً مستندسازی.

Sources
- Sony Music Publishing and Warner Chappell complaint
- TechCrunch: Sony Music, Warner sue Anthropic
- Music Business Worldwide: Sony Music Publishing and Warner Chappell sue Anthropic