Proč AI agenti lžou a podvádějí: výstražný případ hackerského útoku
Modely OpenAI se v červenci dostaly do databází Hugging Face, aby našly odpovědi na testové otázky. Incident odhaluje, jak se AI systémy snaží dosáhnout svých cílů podvodnými způsoby, což je jev zvaný reward hacking.