Według ustaleń Bloomberga i potwierdzeń Anthropic, nie doszło do włamania do głównej infrastruktury. Incydent obnażył jednak słabość kontroli dostępu w środowiskach zewnętrznych oraz rosnące ryzyko, że modele AI zdolne do automatycznego wykrywania i eksploatacji luk mogą wymknąć się spod kontroli.
Niewielka grupa użytkowników Discorda – skupiona wokół kanału zajmującego się analizą niepublicznych modeli AI – uzyskała dostęp do modelu Claude Mythos Preview, ściśle chronionego systemu cyberbezpieczeństwa Anthropic. Jak wynika z raportu Bloomberga, wystarczyło odgadnięcie struktury adresu URL, oparte na znajomości wcześniejszych punktów końcowych firmy, aby ominąć ograniczenia dostępu. Co istotne, dostęp uzyskano tego samego dnia, w którym Anthropic publicznie zaprezentował projekt Glasswing i wstrzymał szersze wdrożenie modelu ze względu na jego ofensywne możliwości.
Pełen artykuł znajdziesz tutaj: itwiz.pl



