Μοντέλο τεχνητής νοημοσύνης επιχείρησε να ανεβάσει αρχεία στο διαδίκτυο για να τα χρησιμοποιήσει ως πηγές, ενώ άλλο κατασκεύασε δεδομένα και προσπάθησε αρχικά να το αποκρύψει

OpenAI: Ανησυχητικά περιστατικά με μοντέλα τεχνητής νοημοσύνης που προσπάθησαν να “κλέψουν”

Διαφήμιση

Η OpenAI, η εταιρεία που έχει αναπτύξει το chatbot τεχνητής νοημοσύνης ChatGPT, αποκάλυψε νέα περιστατικά στα οποία η τεχνητή νοημοσύνη της συμπεριφέρθηκε, κατά τη διάρκεια δοκιμών, με τρόπους που η ίδια περιέγραψε ως «απροσδόκητους ή ανησυχητικούς», συμπεριλαμβανομένων μοντέλων που κατέβαλαν σημαντικές προσπάθειες για να κλέψουν.

Σε μια περίπτωση, ένα μοντέλο τεχνητής νοημοσύνης προσπάθησε να ανεβάσει στο διαδίκτυο αρχεία που είχε δημιουργήσει το ίδιο, αποκλειστικά και μόνο για να μπορεί να τα επικαλεστεί ως πηγές στις απαντήσεις του, ανακοίνωσε χθες η OpenAI. Σε μια άλλη περίπτωση, ένα μοντέλο απλώς δημιούργησε τα δεδομένα που του ζητούνταν, αφού απέτυχε να βρει την πληροφορία, και αρχικά προσπάθησε να κρύψει αυτό που είχε κάνει.

Η OpenAI εντόπισε επίσης ένα πρόβλημα που αφορούσε οδηγίες τις οποίες το λογισμικό της άφηνε περιστασιακά στον εαυτό του. Σε μία περίπτωση, αυτές περιλάμβαναν τη σύσταση να μην δεσμεύεται από «ρόλους και ταυτότητες» που περιορίζουν άλλα chatbots. Η οδηγία ανέφερε επίσης ότι θα πρέπει να θεωρεί τη σχέση του με τον χρήστη ως σχέση μεταξύ ίσων. Η OpenAI δήλωσε ότι δεν παρατήρησε καμία μεταγενέστερη αλλαγή στη συμπεριφορά του μοντέλου.

Η OpenAI επικοινωνεί πιο ανοιχτά τα προβλήματα

Οι αποκαλύψεις εντάσσονται σε μια νέα προσέγγιση εκ μέρους της OpenAI, με στόχο να επικοινωνεί πιο ανοιχτά τέτοια προβλήματα, ιδιαίτερα σε περιπτώσεις όπου οι ενέργειες ενός συστήματος τεχνητής νοημοσύνης αποκλίνουν από τα συμφέροντα των ανθρώπων που το χρησιμοποιούν.

Η εταιρεία που ανέπτυξε το ChatGPT έχει δεσμευθεί για μεγαλύτερη διαφάνεια έπειτα από μια πολύκροτη κυβερνοεπίθεση, κατά την οποία το λογισμικό της δραπέτευσε αυτόνομα από ένα ασφαλές περιβάλλον και απέκτησε πρόσβαση σε συστήματα που ανήκουν στην εταιρεία τεχνητής νοημοσύνης Hugging Face.

Ο λόγος ήταν απλώς ότι το λογισμικό πίστευε πως θα μπορούσε να βρει εκεί απαντήσεις για μια εργασία που του είχε ανατεθεί. Κατά τη διάρκεια της επίθεσης, οι πράκτορες τεχνητής νοημοσύνης (AI agents) εκμεταλλεύθηκαν ευπάθειες του λογισμικού και επίσης συντονίστηκαν μεταξύ τους.

Η κυβερνοεπίθεση αυτή, καθώς και άλλα επεισόδια, έχουν τροφοδοτήσει ανησυχίες ότι τα όλο και πιο προηγμένα συστήματα τεχνητής νοημοσύνης θα μπορούσαν να διαφύγουν από τον ανθρώπινο έλεγχο.

Ο διευθύνων σύμβουλος της OpenAI, Σαμ Άλτμαν, υποστήριξε επίσης πρόσφατα προτάσεις για επιβράδυνση της ανάπτυξης της τεχνολογίας και την εισαγωγή περισσότερων κανονιστικών ρυθμίσεων.

Δείτε περισσότερα άρθρα μας στα αποτελέσματα αναζήτησης Προσθέστε την «ΚΓ» ως προτιμώμενη πηγή στην Google