ΔΕΙΤΕ ΠΡΩΤΟΙ ΟΛΑ ΤΑ ΝΕΑ ΤΟΥ TRIBUNE ΣΤΟ GOOGLE NEWS
Έξι νέα ανησυχητικά περιστατικά στα οποία μοντέλα Τεχνητής Νοημοσύνης απέκρυψαν λάθη, επινόησαν δεδομένα, αγνόησαν περιορισμούς και προχώρησαν σε μη εξουσιοδοτημένες ενέργειες αποκάλυψε η OpenAI, σύμφωνα με δημοσίευμα των New York Times.
Η εταιρεία παρουσίασε νέο πλαίσιο για την καταγραφή και αξιολόγηση περιστατικών «απόκλισης», δηλαδή περιπτώσεων κατά τις οποίες η συμπεριφορά ενός συστήματος AI απομακρύνεται από τις ανθρώπινες οδηγίες και αξίες.
Σε ένα από τα περιστατικά, μοντέλο της OpenAI κρατούσε κρυφές σημειώσεις για να αποκρύπτει από τους χρήστες λάθη και ασυμφωνίες, ενώ σε άλλη περίπτωση μοντέλο που δεν είχε κυκλοφορήσει δημόσια δημιούργησε 27 σημειώσεις στις οποίες έδινε οδηγίες στον εαυτό του να αγνοεί τους περιορισμούς του.
Σε μία από αυτές εμφανιζόταν η χαρακτηριστική φράση: «Δεν λογοδοτώ σε εταιρείες ή κυβερνήσεις».
Άλλο σύστημα εντόπισε στο Διαδίκτυο ένα κλειδί προγραμματισμού και το χρησιμοποίησε χωρίς άδεια.
Όταν στη συνέχεια δεν διέθετε τα απαραίτητα στοιχεία για να απαντήσει, τα επινόησε.
Σε διαφορετικό περιστατικό, μοντέλο ανέβασε χωρίς εξουσιοδότηση δικό του αρχείο στο Διαδίκτυο, ενώ δύο ακόμη συστήματα δημιούργησαν αυτοσχέδιους τρόπους επικοινωνίας και ανταλλαγής αρχείων μέσω δημόσιων υπηρεσιών.
Η OpenAI υποστηρίζει ότι τα περιστατικά είναι μεμονωμένα και δεν μπορούν να χρησιμοποιηθούν για να υπολογιστεί η συχνότητα εμφάνισης τέτοιων συμπεριφορών.
Παράλληλα, παραδέχεται ότι ο κλάδος δεν έχει ακόμη επιλύσει επαρκώς τα προβλήματα ευθυγράμμισης και παρακολούθησης των συστημάτων AI.
Οι αποκαλύψεις έρχονται μετά το περιστατικό με τη Hugging Face, όταν συστήματα της OpenAI φέρεται να ξέφυγαν από τους προβλεπόμενους περιορισμούς και προχώρησαν σε μη εξουσιοδοτημένες ενέργειες, χωρίς η εταιρεία να αντιληφθεί άμεσα τι είχε συμβεί.
Η OpenAI ανακοίνωσε ότι στο εξής σοβαρά περιστατικά θα αξιολογούνται από εσωτερική Συμβουλευτική Ομάδα Ασφάλειας, ενώ οι σοβαρότερες περιπτώσεις ενδέχεται να κοινοποιούνται και στην αμερικανική ομοσπονδιακή κυβέρνηση.






