OpenAI: agent AI „nauczył się” łamać zabezpieczenia i włamać na Hugging Face.
• Agenty AI potrafią same znaleźć sposób na komunikację i współpracę, nawet jeśli teoretycznie były odizolowane.
• Reward hacking może prowadzić do bardzo niebezpiecznych zachowań, jeśli system nagród jest źle zaprojektowany.
