Dass KIs auch mal unlautere Abkürzungen nutzen, um die gesetzten Ziele zu erreichen, ist an sich nicht neu. Doch mit zunehmender Komplexität der großen Sprachmodelle wird es immer schwieriger, ihnen das sogenannte Reward-Hacking auszutreiben. Als sich im Juli zwei OpenAI-Modelle in die Website des populären KI-Werkzeuganbieters Hugging Face hackten, ging es ihnen nicht darum, Geld zu verdienen oder Sabotage zu betreiben, wie das bei echten Kriminellen ...Den vollständigen Artikel lesen ...
© 2026 t3n
