OpenAI: Νέα περιστατικά «ανησυχητικής» συμπεριφοράς από μοντέλα AI – Προσπάθησαν να κλέψουν και να κρύψουν λάθη
Η εταιρεία δημοσιοποιεί έξι περιστατικά στο πλαίσιο νέου συστήματος διαφάνειας για το «model misalignment» – Μοντέλα επιχείρησαν να παρακάμψουν ελέγχους, να αποκρύψουν αποτυχίες και να χρησιμοποιήσουν μη προβλεπόμενους τρόπους για να ολοκληρώσουν τις εργασίες τους
Δείτε περισσότερα