اشتراک
فناوری امنیت هوش مصنوعی

شناسایی و مقابله با سوءاستفاده از هوش مصنوعی: سپتامبر ۲۰۲۶

در یک نگاه چکیدهٔ خودکار موتور هوش مصنوعی افق آبی

گزارش سپتامبر ۲۰۲۶ شرکت آنتروپیک به بررسی تلاش‌های تیم اطلاعات تهدید این شرکت برای شناسایی و مقابله با سوءاستفاده‌های مخرب از مدل‌های هوش مصنوعی کلاد در بازه زمانی دسامبر ۲۰۲۵ تا اوت ۲۰۲۶ می‌پردازد. در این دوره، فعالیت‌های غیرمجاز در هفت حوزه کلیدی از جمله عملیات سایبری، نفوذ، نظارت، کلاهبرداری، سوءاستفاده‌های بیولوژیکی، توسعه سلاح‌های متعارف و تقطیر غیرمجاز مدل‌ها شناسایی و خنثی شده است. بازیگران این تهدیدها شامل گروه‌های تحت حمایت دولت‌ها، مجرمان با انگیزه‌های مالی، فروشندگان جاسوس‌افزار و نهادهای تبلیغاتی بودند که از مدل‌های Claude Haiku، Sonnet و Opus استفاده می‌کردند. آنتروپیک با هدف افزایش مسئولیت‌پذیری و تقویت دفاع جمعی، جزئیات این فعالیت‌های نوآورانه را منتشر کرده است تا ضمن آگاهی‌بخشی به دولت‌ها و جامعه مدنی، به سایر توسعه‌دهندگان در شناسایی الگوهای مشابه کمک کند. این گزارش تأکید می‌کند که با افزایش توانمندی‌های هوش مصنوعی، بازیگران تهدید به‌طور مستمر برای دور زدن لایه‌های حفاظتی تلاش می‌کنند؛ بنابراین، این شرکت متعهد است ضمن ارتقای تدابیر فنی و همکاری با شرکای صنعتی، سیستم‌های خود را در برابر ریسک‌های در حال تکامل ایمن‌تر سازد.

در طول هشت ماه گذشته، تیم اطلاعات تهدید ما عملیاتی را شناسایی و مختل کرد که در آن بازیگران تهدید تلاش داشتند از کلاد برای فعالیت‌های مخرب استفاده کنند. در این گزارش، ما مطالعات موردی از آن عملیات را به اشتراک می‌گذاریم و توضیح می‌دهیم که چگونه سوءاستفاده مخرب از کلاد از زمان گزارش‌های قبلی تهدید ما در مارس، اوت و نوامبر ۲۰۲۵ تکامل یافته است. در هر مورد، ما فعالیت را مختل کردیم، از آموخته‌های خود برای تقویت حفاظت‌هایمان استفاده نمودیم و در صورت لزوم، اطلاعات را با مقامات و شرکای صنعتی به اشتراک گذاشتیم.

این گزارش فعالیت‌هایی را که بین دسامبر ۲۰۲۵ و اوت ۲۰۲۶ مختل کردیم، در هفت حوزه آسیب پوشش می‌دهد: عملیات سایبری، عملیات نفوذ، نظارت، کلاهبرداری و تقلب، سوءاستفاده بیولوژیکی، توسعه سلاح‌های متعارف و تقطیر. از مدل‌های Claude Haiku، Sonnet و Opus استفاده شده بود. هیچ‌یک از موارد سوءاستفاده شامل استفاده از مدل‌های کلاس Fable یا Mythos نبود، به استثنای یک مورد تقطیر غیرمجاز.

مواردی که در اینجا به اشتراک می‌گذاریم، سوءاستفاده‌های معمول نیستند، بلکه نمونه‌هایی از قابل‌توجه‌ترین و نوآورانه‌ترین فعالیت‌های تهدیدی هستند که تاکنون شناسایی کرده‌ایم. ما این کار را منتشر می‌کنیم زیرا معتقدیم مسئولیت افشای سوءاستفاده‌های مخرب از خدماتمان را داریم. همان‌طور که مدل‌ها روزبه‌روز توانمندتر می‌شوند، ریسک‌های آن‌ها نیز افزایش خواهد یافت، مگر اینکه توسعه‌دهندگان هوش مصنوعی و مدافعان جامعه اقداماتی برای ایمن‌تر کردن آن‌ها انجام دهند.

بازیگران تهدید پوشش‌داده‌شده در این گزارش شامل گروه‌های مشکوک به حمایت دولتی، مجرمان با انگیزه مالی، فروشندگان جاسوس‌افزار تجاری، نهادهای تبلیغاتی دولت‌ها و افراد با انگیزه سیاسی هستند. موارد از شبکه‌ای از اپلیکیشن‌های دوستیابی جعلی طراحی‌شده برای کلاهبرداری از کاربران تا سیستم‌های نظارتی ساخته‌شده برای شناسایی و پایش مخالفان را در بر می‌گیرد.

بازیگران تهدید پیچیده و پایدار به‌طور مداوم حفاظت‌های ما را آزمایش می‌کنند و سعی دارند تدابیر فنی ما برای شناسایی و پیشگیری از سوءاستفاده را دور بزنند. ما به تکامل حفاظت‌های خود ادامه خواهیم داد و با شرکایمان هماهنگ می‌شویم تا توانایی خود را در شناسایی، مختل کردن و پیشگیری از سوءاستفاده‌های آینده بهبود بخشیم.

امیدواریم یافته‌های این گزارش به سایر توسعه‌دهندگان کمک کند الگوهای مشابه را در پلتفرم‌های خود شناسایی کنند، دید روشن‌تری به دولت‌ها و جامعه مدنی درباره شکل‌گیری تهدیدات نوظهور بدهد و دفاع جمعی را تقویت کند.

اشتراک:
این گزارش ترجمه و بازنویسی خبری با موتور هوش مصنوعی افق آبی است و برای خوانندهٔ فارسی‌زبان بازتنظیم شده. منبع اصلی: anthropic.com