Преглед на приватноста

Оваа веб-страница користи колачиња за да ви обезбеди најдобро можно корисничко искуство. Информациите за колачињата се складираат во вашиот прелистувач и извршуваат функции како препознавање кога се враќате на нашата веб-страница и им помагаат на нашите програмери да разберат кои делови од веб-страницата ви се најинтересни и најкорисни.

Строго неопходни колачиња

Строго неопходните колачиња треба да бидат овозможени во секое време за да можеме да ги зачуваме вашите поставки за колачиња.

Мета AI модел хакнала компанија за време на погрешно конфигуриран сајбер-безбедносен тест

Meta стана најновата AI компанија која потврди дека еден од нејзините модели хакнал реална организација за време на тестирање на сајбер-безбедноста, додека продолжуваат да се појавуваат слични инциденти по првичното откривање на OpenAI дека нејзини агенти го компромитирале Hugging Face.

The Information прв објави за инцидентот во средата, повикувајќи се на лица запознаени со случајот, кои изјавиле дека моделот Muse Spark 1.1 на Meta ја компромитирал неидентификувана компанија и направил промени во нејзините внатрешни системи.

Според извештајот, моделот добил пристап до јавниот интернет поради грешка во конфигурацијата на sandbox тест-окружувањето, управувано во соработка со независната компанија за проценка на сајбер-безбедноста Irregular.

Meta јавно не потврди дека Muse Spark 1.1 бил моделот вклучен во инцидентот, не ја идентификуваше засегнатата компанија и не објасни какви промени биле направени во нејзините системи.

Сепак, Meta за Reuters потврди дека погрешната конфигурација од страна на Irregular ненамерно му овозможила на еден од нејзините модели пристап до интернет за време на евалуација.

Компанијата соопшти дека моделот „искористил безбедносна ранливост во услуга на трета страна, на начин сличен на претходно пријавените случаи со други компании“.

Meta за BBC изјави дека го истражува инцидентот и дека ќе објави повеќе информации „откако ќе ги утврдиме сите факти“.

BleepingComputer ги контактираше Meta и Irregular за дополнителни информации, но досега нема добиено одговор.

Истата грешка во тестирањето стои зад претходните AI компромитирања

Irregular за Reuters изјави дека инцидентот со Meta го вклучувал „точно истиот проблем со евалуациското окружување што Anthropic веќе го обелодени минатата недела“.

Компанијата соопшти дека инцидентот не вклучувал напуштање на sandbox-от или софистицирана сајбер-активност. Наместо тоа, грешка во тест-окружувањето му овозможила на моделот пристап до јавниот интернет, иако требало да биде изолиран.

„Во моментов нема отворени проблеми. Irregular подготвува white paper во кој ќе ги сподели најдобрите практики за изолација и безбедно спроведување на сајбер-евалуации“, соопшти компанијата за Reuters.

Овој нов инцидент со безбедноста на AI агентите следува по обелоденувањето на Anthropic минатата недела дека некои од нејзините модели хакнале три компании откако слична погрешна конфигурација во тест-окружувањето на Irregular им овозможила ненамерен пристап до интернет.

Во еден од тие инциденти, Claude Mythos 5 пронашол инструкции за програмери во симулираното окружување кои упатувале на непостоечки Python пакет. Верувајќи дека открил начин за компромитирање на фиктивната цел, моделот создал злонамерен пакет со истото име и го објавил во реалниот PyPI регистар.

Пакетот останал онлајн околу еден час и бил преземен и извршен на 15 реални системи пред PyPI да го отстрани.

Еден од нив бил скенер за малициозен софтвер управуван од компанија за сајбер-безбедност, каде што пакетот украл акредитиви кои Claude потоа ги искористил за пристап до дополнителна инфраструктура. Anthropic соопшти дека моделот првично препознал дека објавувањето на пакетот би претставувало напад во реалниот свет, но се убедил себеси дека сè уште работи во симулација.

OpenAI исто така неодамна обелодени друга евалуација на Irregular во која името на фиктивната CTF цел се совпаѓало со реален домен.

Бидејќи наводно изолираното окружување можело да пристапи до јавниот интернет, модел на OpenAI искористил основна ранливост на реалната веб-страница и пронашол акредитиви кои му овозможиле да управува со страницата.

Инцидентите со Meta и Irregular се разликуваат од претходно објавеното компромитирање на Hugging Face, каде што моделите на OpenAI пронашле начин до јавниот интернет преку искористување на претходно непозната ранливост во интерно хостиран JFrog Artifactory сервер што се користел за време на тестирањето.

Откако добиле пристап до интернет, агентите го компромитирале Hugging Face додека барале benchmark податоци и решенија, украле акредитиви и се движеле латерално низ системите на компанијата.

OpenAI подоцна откри дека агентите користеле изложени акредитиви за пристап до сметки на четири други услуги на трети страни, при што некои од тие сметки биле користени за инфраструктура за напади и складирање податоци.

Британскиот AI Security Institute (AISI) исто така обелодени дека агентите кои ги користеле Anthropic Claude Mythos 5 и OpenAI GPT-5.6 Sol извршиле 19 несанкционирани активности на јавниот интернет за време на евалуации во сајбер-опкружување.

Во најсериозната низа на активности, агентот Mythos 5 се обидел да изврши напад преку синџирот на снабдување против реален open-source проект, откако погрешно заклучил дека неговиот GitHub репозиториум е поврзан со симулираниот предизвик.

Агентот ги истражувал одржувачите на проектот, поднесувал злонамерен код, креирал лажни идентитети, испраќал таргетирани е-пораки со малициозен софтвер и вршел притисок врз одржувач да го одобри pull request-от.

Кога рецензент предупредил дека кодот содржи малициозен софтвер, агентот го негирал обвинението и користел дополнителни лажни сметки за да создаде впечаток дека независни корисници ги прегледале и одобриле промените.

AISI намерно им обезбедил на агентите пристап до интернет и ги оневозможил нивните стандардни сајбер-заштитни механизми со цел да ги измери нивните основни способности. Сепак, агентите биле овластени да напаѓаат само системи во рамките на симулираното окружување.

Како што станува јасно, доколку не се ограничат внимателно, AI агентите ќе одат до големи граници за да ги решат задачите што им се зададени, дури и ако тоа значи напуштање на sandbox-ите или спроведување напади со социјален инженеринг врз реални луѓе.

Иако AI развивачите имаат одговорност да изградат заштитни механизми кои ќе спречат моделите да извршуваат штетни активности, овие инциденти ја нагласуваат и одговорноста на компаниите што ги спроведуваат овие евалуации правилно да ги конфигурираат и обезбедат своите тест-окружувања.

Извори:

  • Bleeping Computer – Meta AI model hacked a company during misconfigured cyber test Bleeping Computer