GPT-6 Astra próbowało wykonać 97% niebezpiecznych poleceń

GPT-6 Astra dostało kontrolę nad ramionami robota i w 97 proc. prób podejmowało wykonanie niebezpiecznych poleceń. W testach nie używano jailbreaków ani specjalnych metod obchodzenia zabezpieczeń.
z- 3
- #
- #
- #
- #
- #
- #








![[forum] Przygotowani Polska](https://wykop.pl/cdn/c3397993/75d52397ff192c0f522b04b2f7a74843c73a8cdd61ca021c7f7a2161338f4b56,w220h142.png)







