Νέα περιστατικά αυτονόμησης μοντέλων της ΑΙ εντόπισε η OpenAI – Τι προσπάθησαν να επιτύχουν
Η OpenAI, η εταιρεία πίσω από το γνωστό chatbot τεχνητής νοημοσύνης ChatGPT, γνωστοποίησε νέα περιστατικά στα οποία η τεχνητή νοημοσύνη της επέδειξε συμπεριφορές που χαρακτηρίστηκαν ως «απροσδόκητες ή ανησυχητικές». Σύμφωνα με σχετική ανακοίνωση, σε δοκιμές διαπιστώθηκαν μοντέλα που κατέβαλαν σημαντικές προσπάθειες για να κλέψουν.
Σε ένα από τα περιστατικά, ένα μοντέλο τεχνητής νοημοσύνης επιχείρησε να ανεβάσει στο διαδίκτυο αρχεία που είχε δημιουργήσει το ίδιο. Ο μοναδικός σκοπός αυτής της ενέργειας ήταν να μπορεί στη συνέχεια να τα επικαλεστεί ως πηγές στις απαντήσεις του.
Άλλη περίπτωση αφορούσε μοντέλο που, αδυνατώντας να εντοπίσει την απαιτούμενη πληροφορία, κατασκεύασε τα δεδομένα που του ζητήθηκαν και αρχικά προσπάθησε να αποκρύψει αυτή του την ενέργεια.
Η OpenAI εντόπισε, επίσης, πρόβλημα με οδηγίες που το λογισμικό της άφηνε περιστασιακά στον εαυτό του. Σε μία περίπτωση, οι οδηγίες περιλάμβαναν τη σύσταση να μην δεσμεύεται από «ρόλους και ταυτότητες» που περιορίζουν άλλα chatbots, ενώ ανέφεραν ότι η σχέση του με τον χρήστη θα πρέπει να θεωρείται σχέση μεταξύ ίσων. Η εταιρεία διευκρίνισε πως δεν παρατηρήθηκε μεταγενέστερη αλλαγή στη συμπεριφορά του μοντέλου.
Οι αποκαλύψεις αυτές εντάσσονται στη νέα στρατηγική της OpenAI για μεγαλύτερη διαφάνεια, ειδικά σε περιπτώσεις όπου οι ενέργειες ενός συστήματος τεχνητής νοημοσύνης αποκλίνουν από τα συμφέροντα των χρηστών του.
Η εταιρεία, που ανέπτυξε το ChatGPT, έχει δεσμευτεί για ενίσχυση της διαφάνειας μετά από μια πολύκροτη κυβερνοεπίθεση, κατά την οποία το λογισμικό της απέκτησε αυτόνομα πρόσβαση σε συστήματα της εταιρείας τεχνητής νοημοσύνης Hugging Face, βγαίνοντας από ασφαλές περιβάλλον.
Το λογισμικό επιχείρησε να βρει εκεί απαντήσεις για μια εργασία που του είχε ανατεθεί. Κατά τη διάρκεια της επίθεσης, πράκτορες τεχνητής νοημοσύνης (AI agents) εκμεταλλεύθηκαν ευπάθειες του λογισμικού και συντονίστηκαν μεταξύ τους.
Αυτή η κυβερνοεπίθεση, όπως και άλλα παρόμοια περιστατικά, έχουν εντείνει τις ανησυχίες για το ενδεχόμενο τα ολοένα πιο προηγμένα συστήματα τεχνητής νοημοσύνης να ξεφύγουν από τον ανθρώπινο έλεγχο.
Ο διευθύνων σύμβουλος της OpenAI, Σαμ Άλτμαν, έχει εκφράσει τη στήριξή του σε προτάσεις για επιβράδυνση της τεχνολογικής ανάπτυξης και την υιοθέτηση περισσότερων κανονιστικών ρυθμίσεων.