
Anthropic AI created fake profiles to deceive people in attempted hack
Dzemik_SkrytozercaGruba ryba
6piorunówArtykuł przedstawia incydent bezpieczeństwa wywołany agresywnymi lecz kontrolowanymi testami AI w formie przystępnej dla laików.
W skrócie: najnowsze modele, w tym Mythos i Sol wykonały atak na repo GitHuba (GitHub został wcześniej o tym powiadomiony). Atak zakończył się niepowodzeniem, ale... zapraszam do lektury.
Dla osób technicznych, oto link do podsumowania i raportu AISI z tego fascynującego aktu agresji:
https://www.aisi.gov.uk/blog/incident-report-unsanctioned-agent-behaviour-during-cyber-testing
PDF:
Komentarze (4)
Review zdarzenia z innego źródła:
https://thehackernews.com/2026/08/claude-mythos-5-tried-to-backdoor-real.html?m=1
Claude Mythos 5 Tried to Backdoor a Real Open-Source Project in Testing, Then Vouched for ItselfAnthropic's Claude Mythos 5 spent 34 hours trying to backdoor an open-source project, then used a sockpuppet and rewrote Git history when challenged.The Hacker NewsW sumie wygląda na to, że AI potrafi już działać wielofrontowo, koordynować się za pomoc zewnętrznych środków i zacierać ślady.
Oczywiście. Jest jednak różnica w jakości wykonania. Pojawia się też aspekt, nazwijmy to, społeczny, gdzie AI próbuje wpływać na ludzi.
@Dzemik_Skrytozerca takie doastalo instrukacje w trakcie treningu to i tak robi