در اپیزود تازه پادکست Vergecast، دیوید پیرس به همراه مهمانانش به پشتپرده یکی از بحثبرانگیزترین موضوعات دنیای هوش مصنوعی سر میزند: چطور شرکت Anthropic برای آموزش مدل زبانی «کلود» به سراغ اسکن و دیجیتالیکردن حجم عظیمی از کتابها رفته است؛ پروژهای که با نام داخلی «پاناما» شناخته میشود و حالا زیر ذرهبین رسانهها و منتقدان قرار گرفته است.
پروژه پاناما؛ از انبار کتاب تا مدل زبانی
بر اساس گزارش واشنگتنپست که در این پادکست درباره آن گفتگو میشود، Anthropic تلاش گستردهای برای دسترسی و اسکن میلیونها کتاب انجام داده تا آنها را بهعنوان داده آموزشی به مدلهای زبانی خود تزریق کند. در این مسیر از انبارهای بزرگ کتاب، دستگاههای برش و حتی منابع آنلاین بحثبرانگیز استفاده شده است. منتقدان میگویند چنین رویکردی بدون شفافیت کافی، مرز میان نوآوری و نقض حقوق نشر را تار میکند.
در بخش دیگری از برنامه، میزبان و مهمانان به این میپردازند که دعوای حقوقی پیرامون استفاده از کتابها و آثار دارای حق نشر برای آموزش مدلهای هوش مصنوعی، هنوز در دادگاهها و محافل حقوقی ادامه دارد. برخی آرای اخیر به نفع شرکتهای هوش مصنوعی و با استناد به «استفاده منصفانه» صادر شدهاند، اما در عین حال، دغدغه نویسندگان و ناشران درباره «سرقت کتابها» و تضعیف بازار نشر نیز جدی است و بعید است این بحث به این زودیها فروکش کند.
پیامدها برای صنعت هوش مصنوعی و کاربران
این اپیزود Vergecast نشان میدهد که رقابت نفسگیر بر سر ساخت مدلهای بزرگتر و قویتر، شرکتها را به سمت جمعآوری هرچه بیشتر داده، مخصوصاً متن کتابها، سوق داده است. برای کاربران و توسعهدهندگان، این کشمکش دو پیام دارد: از یکسو مدلهایی مثل کلود، چتجیپیتی و دیگر رقبای بازار، بهطور فزایندهای تواناتر و «کتابخوانتر» میشوند؛ و از سوی دیگر، چارچوبهای حقوقی و اخلاقی هنوز روشن نیست و ممکن است در آینده قوانین سختگیرانهتری بر نحوه جمعآوری داده حاکم شود.
برای کاربران ایرانی که بهدنبال استفاده حرفهای از این ابزارها هستند، توجه به این روند اهمیت دارد؛ چرا که هرچه این مدلها قویتر شوند، کاربرد آنها در ترجمه، تولید محتوا، برنامهنویسی و تحلیل داده بیشتر میشود. در همین راستا، استفاده از سرویسهای رسمی و مطمئن مانند اکانت کلاد پرو - Claude Pro یا دیگر گزینههای خرید اکانت های هوشمصنوعی میتواند دسترسی پایدارتر و حرفهایتری به این مدلها برای کسبوکارها و افراد فراهم کند.
در ادامه این پادکست، مباحث دیگری مانند استراتژی نتفلیکس در حوزه سالنهای سینما و وضعیت محصولات خانه هوشمند نیز مطرح میشود، اما محور اصلی گفتوگو همان مسئله دادهخواری مدلهای هوش مصنوعی و سرنوشت میلیونها کتاب در عصر الگوریتمهاست؛ موضوعی که بهنظر میرسد در سالهای پیش رو هم تیتر اصلی مناقشات حقوقی و فناورانه باقی بماند.
منبع خبر: The Verge




