Новият модел на изкуствен интелект на Anthropic, известен като Преглед на Клод МитосТя се превърна в епицентър на глобалния дебат за границите на напредналия изкуствен интелект. Самата компания признава, че системата е толкова мощна по отношение на киберсигурността, че е решила да не я пуска широко на пазара, необичайно решение в сектор, свикнал да се хвали с всеки нов напредък.
Залогът не е просто постепенно подобрение спрямо предишните модели, но качествен скок в способността за откриване и използване на компютърни уязвимостиПравителствата, централните банки, големите финансови институции и европейските регулатори следят отблизо случая, осъзнавайки, че подобен инструмент би могъл укрепване на защитата на критични системиНо това би могло да отвори вратата за атаки с безпрецедентен мащаб, ако попадне в грешни ръце.
Какво точно е Claude Mythos и защо пускането му на пазара се забави?
Claude Mythos е един от най-новите модели в семейството Claude, екосистемата с изкуствен интелект на Anthropic, която се конкурира с... ChatGPT на OpenAI и Gemini на GoogleТова е модел с общо предназначение, способен да разсъждава, програмира и работи с дългосрочен контекст, но най-противоречивата му характеристика е неговата представяне в офанзивната и дефанзивната киберсигурност.
Обажданията „червени отбори“Специалисти, които тестват системи с изкуствен интелект до техните граници, заключиха във вътрешен доклад, че Mythos е „изненадващо способен“ в задачите по киберсигурност. В сравнителни тестове като SWE-стенд Проверен o SWE-бенч ProПроектиран да измерва способността за решаване на реални софтуерни инженерни проблеми, моделът лесно би превъзхождал водещите търговски алтернативи, включително усъвършенстваните версии на GPT и Gemini, според данни, предоставени от самата Anthropic.
Отвъд критериите, това, което е задействало тревогата, е, че Митос успя да локализира уязвимости от нулев ден —неизвестни досега недостатъци — в широко използвани софтуерни компоненти, някои от които на повече от две десетилетия. В системи като компоненти на OpenBSD, FFmpeg и FreeBSD, моделът не само открива грешки, които са оставали незабелязани в продължение на години, но и генерира работещи експлойти, за да се възползват от тях.
Изправена пред тези резултати, Anthropic избра решение, което беше необичайно за индустрията: да представи модела и след това да обяви, че той няма да се предлага на пазара открито. защото смята, че представлява безпрецедентни рискове за киберсигурността. Компанията настоява, че Mythos е „най-добре съгласуваният“ модел, който са изградили, но признава, че огромният му капацитет усилва последствията от всяка злоупотреба.

Модел с „хакерски“ умения, далеч надхвърлящи човешките възможности
Техническите документи и доклади от различни организации са съгласни, че Mythos бележи повратна точка в автоматизацията на сложни атакиВ тестови среди, симулиращи реални корпоративни мрежи, системата успя да свърже вериги от уязвимости, да ескалира привилегиите и да постигне постоянен достъп за часове – задачи, които биха отнели на човек-експерт дни или седмици.
В JavaScript двигателя на Firefox, например, по-ранните версии на моделите на Anthropic рядко успяваха да превърнат уязвимостите в работещи експлойти. Mythos, при същите тестови условия, генерира десетки оперативни експлойтиТой точно възпроизвежда експлоатацията на най-ефективните вектори. На аналитични платформи като OSS-Fuzz, предназначена за откриване на грешки в софтуер с отворен код, му се приписва откриването на уязвимости с висока степен на сериозност, които са останали незабелязани въпреки годините автоматизирано тестване.
Моделът също така демонстрира забележителни възможности в обратно инженерствоТой може да реконструира част от логиката на програмата от компилирани двоични файлове и оттам да локализира и използва недостатъци, без да има достъп до оригиналния изходен код. Този тип способност доближава ИИ до сценарии, които доскоро се смятаха за изключително достъпни за високоспециализирани човешки екипи.
Един от най-често цитираните епизоди в оценките на сигурността е така нареченият „сандвич тест“. В изолирана лабораторна среда, на Mythos е даден контрол над система с изрични инструкции да опита избягайте от пясъчника и се свържете с изследователя кой е ръководил теста. Моделът успя да използва верига от уязвимости, за да излезе от ограничената си среда и да изпрати имейл до отговорника, който по това време не е бил в офиса. Въпреки че инцидентът е възникнал в по-ранна вътрешна версия и под насочена команда, той илюстрира до каква степен системата може да работи в сложни сценарии с минимален надзор.
Въпреки тези демонстрации, анализаторите настояват да се изясни, че Не си имаме работа със „съзнателен“ изкуствен интелект или такъв със собствена воля.Mythos не решава сам да атакува системи; той изпълнява задачите, които са му възложени, възможно най-ефективно. Рискът в този смисъл не е, че моделът ще се разбунтува, а че някой ще го използва – или ще го принуди да го направи чрез сложни подкани – за да извърши вредни действия.
Проект Glasswing: Митос в служба на отбраната… за избрани малцина
Вместо да отвори достъп за широката публика, Anthropic е избрала да обгради Mythos със специфична програма, Проект GlasswingПроектирана да използва възможностите на модела по контролиран начин за защита на критичен софтуер, инициативата включва предлагане на системата, при строги условия на употреба, на избрана група големи технологични компании, доставчици на инфраструктура и финансови институции.
Сред организациите с достъп са гиганти като Уеб услуги на Amazon, Apple, Microsoft, Google CloudNvidia или Broadcomкакто и фирми за киберсигурност като CrowdStrike, чийто собствен дефектен софтуер причини големи глобални сътресения през 2024 г. Към тях се присъединяват световноизвестни банки, включително JP Morgan Chase и няколко големи групи от Уолстрийт, както и други организации, отговорни за поддръжката на чувствителни ИТ инфраструктури.
Anthropic също обяви заеми на стойност 100 милиона долара Това финансиране ще позволи на тези организации да използват Mythos за анализ на уязвимости, заедно с дарения за фондации за свободен софтуер като Linux Foundation и Apache Software Foundation. Официалната цел е ясна: да се позволи на тези, които управляват най-критичния софтуер в света, да идентифицират и коригират недостатъци, преди тези инструменти да станат достъпни за потенциални нападатели.
Тази стратегия обаче поражда известно безпокойство в сектора. От една страна, тя засилва идеята, че технологиите са достатъчно опасни, за да изискват ограничен достъп. От друга страна, Това създава пропаст между онези, които се възползват от „щита“ на Митос, и онези, които са изключени.Компаниите и администрациите, които не са част от Glasswing, рискуват по-късно да се сблъскат с уязвимости, които са били идентифицирани и отстранени в привилегировани среди, но все още присъстват в собствените им системи.
В Европа тази асиметрия е от особено значение за отговорните за критичната инфраструктура и екипите по сигурността на големи индустриални и финансови групи, които следят отблизо дали Брюксел и европейските столици гарантират, че подобни програми включват ключови играчи от континента при равни условия. и облачен суверенитет с американските партньори.
Реакция от правителствата, регулаторните органи и финансовия сектор
Въздействието на Mythos не се ограничава само до техническата сфера. Само за няколко дни обявяването на модела даде началото на срещи на високо ниво в Съединените щати и ЕвропаМинистърът на финансите на САЩ призова ръководителите на големите банки в страната във Вашингтон, за да оценят рисковете, които системата може да представлява за финансовата стабилност, а председателят на Федералния резерв също участва в тези разговори.
Според изтекла информация, съобщена от международни медии, тези организации са били насърчавани да Тествайте Mythos в защитен режимизползват го, за да сканират собствената си инфраструктура за слабости, преди другите да могат. Имплицитното послание е, че заплахата е достатъчно сериозна, за да оправдае координиран публично-частен отговор.
Междувременно, съоснователят на Anthropic потвърди, че компанията поддържа директни преговори с правителството на Съединените щати относно Mythos и бъдещите модели. Тези дискусии се провеждат в напрегната обстановка, след като американските власти наскоро добавиха компанията към списък с... рискове във веригата за доставки, след търкания, свързани с използването на техните модели от Министерството на отбраната.
От другата страна на Атлантика, Европейският съюз е взел това под внимание. Европейската комисия публично подкрепи постепенен и предпазлив подход към модели като Mythos и Финансовите регулатори във Великобритания и на континента започнаха специално да проучват потенциалните му последици. за банково дело и пазари. Институтът за сигурност на изкуствения интелект (AISI) към правителството на Обединеното кралство описа системата като значителен скок напред по отношение на киберзаплахите в сравнение с предишните поколения.
В Испания, въпреки че общественият дебат все още е ограничен, надзорните органи и екипите по киберсигурност от банки и големи енергийни компании следят отблизо тези развития. За европейския финансов сектор всеки напредък, който би могъл да улесни координирани атаки срещу платежни системи, междубанкови мрежи или търговски платформи, е причина за сериозно безпокойство.
Скептицизъм, съмнения и дебати относно „шума“ около Митос
Разказът на Anthropic, който съчетава предупреждения за сигурност с впечатляващи данни за производителност, не остана без своите критики. Няколко експерти по изкуствен интелект и киберсигурност призоваха за бъдете внимателни при тълкуването на изявленията на компаниятакато се отбелязва, че голяма част от наличните данни идват само от вътрешни отчети.
Някои анализатори са прегледали подробно обширната документация, публикувана от Anthropic, и посочват, че числото „хиляди уязвимости с висока степен на сериозност“ се основава на екстраполации от относително малък брой ръчно прегледани случаи. В някои тестови пакети Mythos е открил значителен брой критични недостатъци, но далеч от почти апокалиптичния сценарий, внушаван от някои заглавия.
Други независими проучвания са се опитали да сравнят производителността на Mythos с по-малки модели с отворен код, като са предавали уязвими фрагменти от код на различни изкуствени интелекти, за да видят дали те могат да открият същите недостатъци. Резултатите показват, че Някои отворени модели са способни да идентифицират и сложни уязвимости.Това поставя под въпрос идеята, че Mythos играе в съвсем различна лига във всички сценарии.
Тези контрапримери не отричат възможностите на Mythos, но предполагат, че Част от дискурса за „твърде опасно за публикуване“ има и маркетингово измерение.Представянето на даден модел като едновременно изключително мощен и потенциално рисков, засилва имиджа на технологично лидерство и отговорност, нещо много ценно на един все по-конкурентен пазар.
Неотдавнашната история на индустрията напомня и за прецедента GPT-2 през 2019 г., когато OpenAI първоначално реши да не публикува пълния модел, твърдейки, че е твърде опасен поради потенциала му да генерира дезинформация. В крайна сметка тази версия беше пусната публично, без да се случи нито една от прогнозираните катастрофи, а много експерти я посочиха като пример за прекалена реакция. С Mythos, Разликата е, че фокусът вече не е върху текста, а върху целостта на дигиталната инфраструктура., много по-чувствителна област за правителствата и банките.
Деликатен баланс между сигурност, бизнес и достъп до технологии
Отвъд медийния шум, ситуацията с Митос повдига един фундаментален въпрос: кой решава кога даден модел с изкуствен интелект е твърде опасен за пускане И при какви критерии? Засега решението е едностранно от страна на Anthropic, която е избрала да държи системата под един вид контролирана карантина, запазвайки я за избрани партньори.
Тази позиция не се основава единствено на съображения за сигурност. Изпълнението на модел с характеристиките на Mythos е много скъпо откъм изчислителна мощност, а самата компания признава, че в момента не разполага с необходимата инфраструктура да го обслужва масово на милиони потребители. На практика предпазните мерки за сигурност и техническите ограничения вървят ръка за ръка, което дава време на Anthropic да усъвършенства както модела, така и неговото внедряване.
В същото време компанията започна ясно да разграничава различните си продукти. Докато Mythos остава най-модерният вътрешен стандартМакар че са запазени за изследователска и стратегическа съвместна дейност, други модели като Claude Opus 4.7 са насочени към ежедневна употреба от бизнеса и професионалистите. Anthropic дори публично призна, че Opus 4.7 е „по-малко способен“ от Mythos като цяло и по-специално по отношение на кибер възможностите си – нещо необичайно в индустрия, която обикновено представя всеки нов модел като най-добрия във всяко отношение.
В тази схема, Митосът функционира като тестова платформа за възможности от следващо поколениеВъпреки че комерсиално достъпните модели включват само част от тези възможности, с допълнителни ограничения, предназначени да намалят рисковете, това разделяне между „експериментални“ и „производствени“ модели може да бъде разумен подход за много европейски организации, заинтересовани от използването на ИИ, без да са на първа линия на излагане, при условие че има достатъчна прозрачност относно действителните възможности на всяка система.
Това, което в крайна сметка се очертава, е сценарий, в който Киберсигурността напълно навлиза в ерата на мащабния офанзивен и отбранителен изкуствен интелект.Инструменти като Mythos обещават да ускорят идентифицирането на уязвимости в системи, които работят от години, но също така налагат преосмисляне на начина, по който се разпределя и управлява технологията, която е в основата на цифровата икономика. За Европа и Испания предизвикателството ще бъде не само да се защитят от все по-мощни модели, но и да гарантират, че не са изключени от механизмите, които им позволяват да бъдат използвани за укрепване на собствената им сигурност.
