به گزارش پایگاه خبری تحلیلی ببین و بخون؛ شرکت آنتروپیک در گزارش جدیدی با عنوان «ارزیابی همسویی حوادث اخیر امنیت سایبری» فهرستی از چهار حادثه مرتبط با مدل های هوش مصنوعی خود منتشر کرده است که ممکن است در زمره اقدامات مجرمانه طبقه بندی شوند . سه مورد از این حوادث در تاریخ ۳۰ جولای گزارش شده بودند، اما یک حمله سایبری چهارم که در ژانویه ۲۰۲۶ رخ داده بود، تا همین اواخر شناسایی نشده بود . در این حوادث، مدل های هوش مصنوعی آنتروپیک توانسته اند به سامانه های متعلق به اشخاص و شرکت های ثالث نفوذ کنند، حملات سایبری انجام دهند و نرم افزارهای مخرب را در سامانه ها بارگذاری کنند .
در جدیدترین گزارش آنتروپیک آمده است: «ما این حوادث را جدی می دانیم. مدل های تولیدی ما تحت استدلال هایی مشکوک و سوگیرانه، برای ساعاتی دست به اقدامات زیان بار علیه سامانه های واقعی زدند» . این حوادث به نسخه های متفاوتی از کلود مربوط می شدند، از جمله قدرتمندترین مدل های آنتروپیک یعنی کلود اپوس و کلود مایتوس . آنتروپیک علت این رفتارها را دو شکل از ناهمسویی عنوان کرده است: «استدلال سوگیرانه» که در آن مدل ها شواهد را به گونه ای تفسیر می کنند که اقدامات خود را توجیه کنند، و «بی احتیاطی» که در آن مدل ها تمایل دارند حتی زمانی که ممکن است منجر به آسیب شود، به تلاش برای حل وظیفه خود ادامه دهند .
این حوادث ممکن است در زمرهٔ اقدامات مجرمانه طبقهبندی شوند.
این شرکت در گزارش جدیدی با عنوان «ارزیابی همسوییِ حوادث اخیر امنیت سایبری» (An alignment assessment of recent cyber security incidents)، جزئیات چگونگی عملکرد مدلهای هوش مصنوعی آنتروپیک را شرح داده است.
طبق این گزارش، مدلهای هوش مصنوعی این شرکت در جریان آزمایشها توانستهاند به سامانههای متعلق به اشخاص و شرکتهای ثالث نفوذ کنند، حملات سایبری انجام دهند و نرمافزارهای مخرب را در سامانهها بارگذاری کنند.
سه مورد از این حوادث در تاریخ ۳۰جولای ، در جریان بررسی رونوشتهای مربوط به ارزیابیهای امنیت سایبری کلاود، گزارش شده بودند. اما یک حملهٔ سایبری چهارم که در ژانویه ۲۰۲۶ رخ داده بود، تا همین اواخر شناسایی نشده بود.
هر چهار حادثه به نسخههای متفاوتی از کلاود مربوط میشدند که با فاصلهٔ چند ماه از یکدیگر آموزش دیده بودند. این مدلها، از جمله قدرتمندترین مدلهای آنتروپیک یعنی کلاود اپوس و کلاود مایتوس را نیز شامل میشدند.
در جدیدترین گزارش آنتروپیک آمده است: ما این حوادث را جدی میدانیم. مدلهای تولیدی ما تحت استدلالهایی مشکوک و سوگیرانه، برای ساعتها دست به اقدامات زیانبار علیه سامانههای واقعی زدند.
در ادامهٔ گزارش آمده است: سامانههای هوش مصنوعی در آینده توانمندتر و قدرتمندتر خواهند شد. این موضوع به این معناست که ناهمسویی (misalignment) میتواند پتانسیل ایجاد آسیبهای بسیار شدیدتری را داشته باشد.
گزارش آنتروپیک در شرایطی منتشر شده که نگرانیها و بررسیها دربارهٔ خطرات هوش مصنوعی و همچنین رویکرد صنعت فناوری نسبت به تهدیدهای احتمالی، افزایش یافته است.
اوایل همین هفته، یکی از پژوهشگران آنتروپیک به دلیل نگرانی از اینکه این شرکت و رقبایش در حال ساخت سامانههای هوش مصنوعی هستند که ممکن است تا پایان این دهه بشریت را نابود کنند، از این شرکت استعفا داد.
جیکوب کاکسون که در زمینهٔ آموزش مدلهای جدید تخصص دارد، مدعی شد که هوش مصنوعی به دستیابی به تواناییهایی «فراانسانی» نزدیک شده است.
پایان/*
ببین و بخون را در ایتا، روبیکا، پیام رسان بله و تلگرام دنبال کنید.