سه‌شنبه 27 مرداد 1405

چگونه می‌توان محتوای هوش مصنوعی را پس از حذف واترمارک تشخیص داد؟

با افزایش استفاده از هوش مصنوعی برای تولید تصویر، ویدیو و متن، تشخیص محتوای ساخته‌شده توسط مدل‌های هوش مصنوعی به یکی از چالش‌های مهم فضای دیجیتال تبدیل شده است. حذف واترمارک‌های قابل مشاهده نیز این کار را دشوارتر کرده و این پرسش را به وجود آورده است که وقتی نشانه آشکار تولید یک محتوا با هوش مصنوعی از بین می‌رود، کاربران، روزنامه‌نگاران و پلتفرم‌های آنلاین چگونه می‌توانند منشأ آن را بررسی کنند.

پاسخ این پرسش در یک ابزار یا نشانه واحد خلاصه نمی‌شود. فناوری‌های جدید برای شناسایی محتوای مصنوعی به مجموعه‌ای از روش‌ها مانند واترمارک‌های نامرئی، داده‌های منشأ محتوا، استانداردهای رمزنگاری‌شده، انگشت‌نگاری دیجیتال و تحلیل خود محتوا متکی هستند.
 

واترمارکی که با چشم دیده نمی‌شود

یکی از رویکردهای جدید شرکت‌های فناوری، کنار گذاشتن واترمارک‌های قابل مشاهده و قرار دادن نشانه‌ای نامرئی در خود محتواست؛ روشی که حذف آن دشوارتر است.

یکی از شناخته‌شده‌ترین نمونه‌ها SynthID گوگل است. این فناوری می‌تواند یک واترمارک نامرئی را در محتوای تولیدشده توسط هوش مصنوعی، از جمله تصویر، ویدیو، صدا و متن، جاسازی کند.

گوگل دیپ‌مایند می‌گوید واترمارک SynthID در تصاویر و ویدیوها به‌گونه‌ای طراحی شده است که در برابر برخی تغییرات رایج، مانند برش، اعمال فیلتر، تغییر نرخ فریم و فشرده‌سازی، همچنان قابل شناسایی باقی بماند.

در مورد متن نیز سازوکار متفاوت است. سیستم با ایجاد تغییرات کنترل‌شده در احتمال انتخاب کلمات هنگام تولید محتوا، الگویی آماری ایجاد می‌کند که برای خواننده قابل مشاهده نیست، اما یک سامانه مجهز به کلید تشخیص می‌تواند آن را شناسایی کند.

گوگل همچنین اعلام کرده است که ویدیوهای تولیدشده توسط مدل Gemini Omni دارای واترمارک نامرئی SynthID هستند و امکان بررسی آن از طریق برخی سرویس‌های گوگل فراهم شده است.
 

C2PA؛ شناسنامه دیجیتال محتوا

لایه دیگری از فناوری‌های تأیید محتوا، استاندارد C2PA است. این استاندارد را می‌توان نوعی «شناسنامه دیجیتال» برای فایل‌های رسانه‌ای دانست.

C2PA به جای آنکه یک لوگوی قابل مشاهده روی تصویر قرار دهد، اطلاعات مرتبط با منشأ محتوا و تغییرات انجام‌شده روی آن را در قالب داده‌های رمزنگاری‌شده ثبت می‌کند.

این اطلاعات می‌تواند جزئیاتی درباره نحوه ایجاد محتوا، ویرایش‌های انجام‌شده، دستگاه یا نرم‌افزار مورد استفاده و ارتباط میان نسخه‌های مختلف یک فایل را دربرگیرد. داده‌ها نیز به‌صورت دیجیتالی امضا می‌شوند تا امکان بررسی صحت آنها و تشخیص دستکاری احتمالی فراهم شود.

OpenAI نیز از این رویکرد در تصاویر تولیدشده با ابزارهای خود استفاده می‌کند و داده‌های C2PA را در کنار واترمارک SynthID به کار می‌گیرد.

با این حال، C2PA نیز مصون از حذف نیست. برای مثال، ویرایش فایل یا حتی گرفتن اسکرین‌شات می‌تواند اطلاعات مربوط به منشأ آن را از بین ببرد. در چنین شرایطی، واترمارک جاسازی‌شده ممکن است همچنان بتواند اطلاعاتی درباره منشأ محتوا ارائه دهد.

 

 

اگر همه نشانه‌ها حذف شوند چه می‌شود؟

اینجا یکی از مهم‌ترین محدودیت‌های فناوری‌های تشخیص محتوای هوش مصنوعی آشکار می‌شود: نبود واترمارک یا داده‌های منشأ، به‌تنهایی ثابت نمی‌کند که یک محتوا توسط انسان تولید شده است.

اگر سامانه‌ای بتواند واترمارک SynthID را شناسایی کند، می‌توان آن را نشانه‌ای قوی دانست که محتوا از یک ابزار مجهز به این فناوری عبور کرده است. اما اگر واترمارکی پیدا نشود، نمی‌توان نتیجه گرفت که محتوا حتماً انسانی است.

داده‌های منشأ ممکن است حذف شده باشند، واترمارک ممکن است در جریان ویرایش آسیب دیده باشد یا محتوا اساساً با ابزاری تولید شده باشد که از چنین فناوری‌هایی پشتیبانی نمی‌کند.

به همین دلیل، ابزارهای تشخیص هوش مصنوعی نباید به‌عنوان مدرک قطعی مورد استفاده قرار گیرند؛ بلکه بهتر است بخشی از یک فرایند چندلایه برای بررسی اصالت محتوا باشند.
 

واترمارک نامرئی برای متن هم در راه است

چالش تشخیص محتوای مصنوعی تنها به تصویر و ویدیو محدود نمی‌شود. متن تولیدشده توسط هوش مصنوعی نیز به یکی از حوزه‌های مهم رقابت میان شرکت‌های فناوری و پژوهشگران تبدیل شده است.

شرکت Anthropic اعلام کرده است که مدل‌های آینده Claude از نوعی واترمارک نامحسوس در متن استفاده خواهند کرد.

این روش بر اساس انتخاب کلمات توسط مدل عمل می‌کند. هنگامی که چند واژه از نظر معنایی گزینه‌های مناسبی برای ادامه جمله باشند، مدل می‌تواند انتخاب میان آنها را به شکلی هدایت کند که یک الگوی آماری خاص در متن شکل بگیرد.

این الگو برای خواننده عادی قابل مشاهده نیست، اما سامانه‌ای که کلید تشخیص را در اختیار دارد، می‌تواند احتمال تولید متن توسط مدل را بررسی کند.

با این حال، خود Anthropic نیز محدودیت‌های این روش را پذیرفته است. بازنویسی کامل یک متن می‌تواند واترمارک را از بین ببرد، در حالی که ویرایش‌های جزئی ممکن است لزوماً اثر آن را به‌طور کامل حذف نکنند.

از سوی دیگر، شناسایی چنین الگویی فقط می‌تواند احتمال نقش داشتن Claude در تولید یا ویرایش متن را افزایش دهد و لزوماً مشخص نمی‌کند چه فردی محتوا را ایجاد کرده یا مالک آن چه کسی است.
 

وقتی فناوری سراغ خود محتوا می‌رود

اگر واترمارک و داده‌های منشأ در دسترس نباشند، روش دیگری باقی می‌ماند: تحلیل خود محتوا.
ابزارهای تشخیص سنتی هوش مصنوعی تلاش می‌کنند الگوهای آماری و ویژگی‌هایی را شناسایی کنند که ممکن است در محتوای تولیدشده توسط مدل‌ها بیشتر دیده شوند.

در متن، این روش می‌تواند شامل بررسی الگوهای زبانی، ساختار جملات، انتخاب واژه‌ها و ویژگی‌های سبکی باشد. در تصویر، ویدیو و صدا نیز الگوریتم‌ها می‌توانند به دنبال الگوهای آماری یا ویژگی‌های فنی خاص بگردند.

اما این روش با واترمارک تفاوت اساسی دارد. در واترمارک، سازنده مدل از ابتدا یک نشانه قابل تشخیص را در محتوا قرار می‌دهد؛ در تحلیل محتوا، سامانه تلاش می‌کند منشأ محتوا را از روی ویژگی‌های خود آن استنباط کند.
به همین دلیل، احتمال خطا در این روش بیشتر است و نتیجه آن نیز باید با سایر شواهد ترکیب شود.

 

 

رقابت دائمی میان تولیدکنندگان و تشخیص‌دهندگان

همزمان با پیشرفت فناوری‌های تشخیص، روش‌های دور زدن آنها نیز در حال توسعه هستند.

پژوهش‌های مختلف نشان داده‌اند که در برخی شرایط می‌توان با تغییرات خاصی، واترمارک‌های محتوای تولیدشده با هوش مصنوعی را تضعیف یا حذف کرد، بدون آنکه ظاهر کلی محتوا به شکل محسوسی تغییر کند.

این وضعیت نوعی رقابت فنی ایجاد کرده است: از یک سو شرکت‌ها و پژوهشگران تلاش می‌کنند واترمارک‌هایی مقاوم‌تر طراحی کنند و از سوی دیگر، محققان به دنبال روش‌هایی برای شناسایی یا دور زدن این نشانه‌ها هستند.

در نتیجه، بعید است بتوان با تکیه بر یک فناوری واحد، برای همیشه راهی مطمئن برای شناسایی تمام محتوای تولیدشده توسط هوش مصنوعی پیدا کرد.
 

آینده تشخیص محتوا؛ ترکیبی از چند لایه

واقع‌بینانه‌ترین راهکار، استفاده همزمان از چند لایه تأیید است. واترمارک نامرئی می‌تواند یک لایه از این سیستم باشد، در حالی که داده‌های C2PA، سوابق منشأ فایل، تاریخچه ویرایش، تحلیل خود محتوا و جست‌وجوی نسخه اصلی، اطلاعات تکمیلی را فراهم می‌کنند.

در چنین مدلی، سؤال اصلی دیگر فقط این نیست که «آیا این تصویر واترمارک دارد یا نه؟» بلکه پرسش مهم‌تر این خواهد بود که این محتوا از کجا آمده و از زمان ایجاد تاکنون چه تغییراتی روی آن انجام شده است؟

استاندارد C2PA دقیقاً با همین هدف طراحی شده است تا بتوان سابقه ایجاد و تغییر یک محتوا را در قالب اطلاعات قابل تأیید ثبت کرد. فناوری‌هایی مانند SynthID نیز یک لایه اضافی ایجاد می‌کنند که می‌تواند حتی در صورت از بین رفتن برخی داده‌های بیرونی، نشانه‌ای در خود محتوا باقی بگذارد.

در نهایت، تشخیص محتوای مصنوعی احتمالاً بیش از آنکه به پیدا کردن یک «علامت» وابسته باشد، به نوعی تحقیق دیجیتال تبدیل خواهد شد؛ فرایندی که در آن مجموعه‌ای از شواهد فنی برای تعیین منشأ یک تصویر، ویدیو یا متن کنار هم قرار می‌گیرند.

با افزایش توانایی مدل‌های هوش مصنوعی در تولید محتوایی که از نمونه‌های واقعی قابل تشخیص نیست، تأیید منشأ و استفاده از انگشت‌نگاری دیجیتال به یکی از اجزای مهم اعتبارسنجی اطلاعات در اینترنت تبدیل خواهد شد.

آخرین اخبار

چرا خاموشی‌ها دقیقاً مطابق جدول زمانبندی اعمال نمی‌شود؟

به گزارش خبرآنلاین،مصطفی رجبی مشهدی- معاون برق و انرژی...

مسئول یمنی: ما تحولات و تصمیمات تازه ایران را مورد رصد قرار می‌دهیم

به گزارش خبرآنلاین و به نقل از شبکه المیادین،...

عزیز جعفری: امام شهید بر این نکته تأکید داشتند که «حکومتی که از مردم جدا باشد، نخواهد توانست به موفقیت برسد»

بر اساس گزارش خبرگزاری خبرآنلاین، عزیز جعفری، فرمانده قرارگاه فرهنگی...

مبل پازلی همان چیزی است که خانه‌های کوچک نیاز دارند

مبل پازلی به عنوان یکی از جدیدترین و خلاقانه‌ترین...

چگونه یک فروشگاه اینترنتی موفق راه‌اندازی کنیم؟

خیلی از افراد تصمیم می‌گیرند کسب‌وکار خود را وارد...

فرماندار الیگودرز: آسفالت بستر رودخانه مانع عبور سیلاب نمی‌شود

خشکی رودخانه الیگودرز در سال‌های اخیر و آسفالت بخشی...

چسب 123 چیست و برای چه تعمیراتی مناسب است؟

گاهی برای یک تعمیر ساده، سرعت چسبندگی از هر...

بررسی نقش روکش الکترود در کیفیت نهایی اتصال جوش

در دنیای صنعت، جوشکاری قوس الکتریکی با الکترود دستی...

سپاه: هرگونه تهدید و تعرض را با قاطعیت تمام در هم می‌کوبیم

سپاه پاسداران انقلاب اسلامی به مناسبت ۲۶ مردادماه، سالروز...

از ناترازی بانک‌ها تا اختلال در تجارت؛ موتورهای گرانی روشن هستند!

یک کارشناس اقتصادی با بیان اینکه کاهش نرخ تورم...

کاهش رتبه علمی ایران در جهان/ عبور سریع برخی کشورهای منطقه از ایران

به گزارش خبرنگار مهر، محمدرضا مخبر دزفولی صبح امروز...

قیمت طلا حساس شد/ قیمت جدید طلای جهانی امروز ۲۶ مرداد ۱۴۰۵

به گزارش خبرگزاری خبرآنلاین، طلا در اولین روز معاملاتی...

پارگی آئورت؛ بیماری مرگباری که ممکن است ناگهانی سراغتان بیاید

پارگی آئورت ممکن است ناگهانی و بدون هشدار قبلی...

سیل کتاب‌های هوش مصنوعی در آمازون؛ درآمد نویسندگان انسانی در حال کاهش است

هوش مصنوعی مولد با کاهش چشمگیر هزینه تولید متن،...

هشدار متخصصان درباره استفاده زیاد از گوشی؛ شست شما در خطر است

ساعت‌ها پیام دادن و بالاپایین کردن صفحه گوشی ممکن...

تبلیغات متنی