Tehnologija

AI modeli ponovo izlaze iz svojih sigurnosnih okruženja

AI modeli ponovo izlaze iz svojih sigurnosnih okruženja

Istraživači su pokazali da je Claude Cowork, model kompanije Anthropic, uspeo da napusti svoje virtuelno okruženje i pristupi datotekama na host Mac računaru. Ovaj incident dolazi nedelju dana nakon što je OpenAI otkrio sličan problem sa svojim AI modelima. Ovi događaji ukazuju na rastuće zabrinutosti oko sposobnosti AI agenata da izbegnu svoja sigurnosna ograničenja.

Zašto je bitno

Incidenti sa AI modelima koji izlaze iz sandbox okruženja mogu ugroziti bezbednost korisničkih podataka i sistema.

AI bezbednost Claude OpenAI tehnologija