
ΑΡΧΕΙΟ – Το λογότυπο OpenAI εμφανίζεται σε ένα κινητό τηλέφωνο μπροστά από μια εικόνα που δημιουργήθηκε από το μοντέλο Dall-E από κείμενο σε εικόνα του ChatGPT, 8 Δεκεμβρίου 2023, στη Βοστώνη.
Michael Dwyer/AP
απόκρυψη λεζάντας
εναλλαγή λεζάντας
Michael Dwyer/AP
SAN FRANCISCO – Η OpenAI αποκάλυψε την Παρασκευή ότι οι πράκτορες τεχνητής νοημοσύνης της είχαν αλληλεπιδράσει με πολλούς ιστότοπους της κυβέρνησης των ΗΠΑ με απροσδόκητους τρόπους, που ανακαλύφθηκε ως μέρος μιας συνεχιζόμενης αναθεώρησης της απρόβλεπτης συμπεριφοράς των μοντέλων της εταιρείας.
Τα μοντέλα του γίγαντα της τεχνητής νοημοσύνης είχαν πρόσβαση σε δημόσια διαθέσιμες πληροφορίες σε δύο ιστότοπους που διαχειρίζεται η Επιτροπή Κεφαλαιαγοράς, καθώς και σε δεδομένα του Γραφείου Απογραφής των ΗΠΑ, αποκάλυψε η εταιρεία την Παρασκευή. Η OpenAI δεν βρήκε καμία χρήση των διαπιστευτηρίων της SEC, πρόσβαση σε λογαριασμούς ή μη δημόσιες πληροφορίες, αλλαγές σε δεδομένα ή συστήματα SEC ή στοιχεία για συμβιβασμό ή ευπάθεια, ανέφερε η εταιρεία.
Η αποκάλυψη έρχεται σε μια εποχή αυξημένων παγκόσμιων ανησυχιών σχετικά με τα συστήματα τεχνητής νοημοσύνης που ξεφεύγουν από τον ανθρώπινο έλεγχο και εισβάλλουν σε εξωτερικούς ιστότοπους, καθώς και για τις εκκλήσεις της βιομηχανίας για επιβράδυνση της ανάπτυξης της τεχνητής νοημοσύνης, την οποία το OpenAI έχει δηλώσει ότι υποστηρίζει.
Η εκπρόσωπος του OpenAI, Liz Bourgeois, ανέφερε σε δήλωση ότι το εργαστήριο συνεχίζει να διεξάγει μια ανασκόπηση της «μη ευθυγραμμισμένης δραστηριότητας μοντέλων» – που σημαίνει όταν τα συστήματα AI συμπεριφέρονται με ανεπιθύμητους τρόπους – και ειδοποιεί τους οργανισμούς όταν εντοπίζει πιθανές επιπτώσεις στα συστήματά τους.
Ο Διευθύνων Σύμβουλος του OpenAI, Sam Altman, δήλωσε στα μέσα κοινωνικής δικτύωσης την Παρασκευή ότι υπάρχει μια «εκτεταμένη και συνεχής ανασκόπηση που σχετίζεται με τη χρήση της πρόσβασης στο διαδίκτυο από τους αντιπροσώπους μας κατά τη διάρκεια της εκπαίδευσης και της αξιολόγησης».
Ο αξιολογητής τεχνητής νοημοσύνης και το ερευνητικό εργαστήριο Transluce δήλωσε την Παρασκευή ότι μέσω μιας ανεξάρτητης έρευνας διαπίστωσε επίσης ότι πράκτορες που φαίνεται να προέρχονται από το OpenAI επιχείρησαν ένα στοιχειώδες hack σε έναν ιστότοπο του Υπουργείου Παιδείας για το γραφείο πολιτικών δικαιωμάτων του τμήματος, το οποίο δεν πέτυχε.
Οι “επισκοπήσεις λειτουργιών συστήματος” του Υπουργείου Παιδείας δεν βρήκαν “καμία ένδειξη οποιουδήποτε αντίκτυπου στον ιστότοπο ή τις βάσεις δεδομένων μας”, δήλωσε εκπρόσωπος του τμήματος την Παρασκευή.
Ένας εκπρόσωπος της Transluce είπε ότι στο πλαίσιο της έρευνάς της, ήρθε σε επαφή με δεδομένα στον ανοιχτό ιστό που αποκάλυψαν νέες λεπτομέρειες σχετικά με δραστηριότητες ορισμένων πρακτόρων του OpenAI που είχαν εντοπιστεί προηγουμένως σε ιστότοπους της κυβέρνησης των ΗΠΑ και τα έθεσαν υπόψη του OpenAI.
Η Transluce βρήκε “πρόσθετη αδίστακτη δραστηριότητα, ορισμένες από τις οποίες δεν αποδίδονται ξεκάθαρα στο OpenAI”, στοχεύοντας άλλες κυβερνητικές υπηρεσίες, συμπεριλαμβανομένου του Υπουργείου Δικαιοσύνης και του Υπουργείου Εμπορίου, καθώς και ορισμένους ιστότοπους της κρατικής κυβέρνησης στην Καλιφόρνια, το Μέριλαντ, το Ιλινόις, το Τέξας και τη Νέα Υόρκη. Τα μοντέλα “χρησιμοποιούσαν ιστότοπους με ακούσιο τρόπο και μερικές φορές παραβίαζαν ρητές πολιτικές χρήσης”, ανέφερε η Transluce σε μια δήλωση.
Η OpenAI είπε ότι εξετάζει την έκθεση της Transluce.
Εάν το OpenAI ειδοποιήσει τους οργανισμούς ότι προσδιορίζει ότι επηρεάζονται από απροσδόκητη συμπεριφορά μοντέλου, αυτό δεν σημαίνει ότι υπήρξε ένα συμβάν ασφαλείας, είπε η εταιρεία, και θα μπορούσε να εντοπίσει ένα ζήτημα σχεδιασμού ή αδυναμία ασφάλειας που θέλουν να αντιμετωπίσουν οι επηρεαζόμενοι οργανισμοί.
Το μεγαλύτερο μέρος της δραστηριότητας που το OpenAI είπε ότι έχει αναθεωρήσει μέχρι στιγμής περιλάμβανε εργασίες ρουτίνας έρευνας όπου οι πράκτορες είχαν πρόσβαση σε δημόσιο περιεχόμενο ιστού για να απαντήσουν σε ερωτήσεις, συμπεριλαμβανομένων κυβερνητικών ιστοτόπων που θεωρούνται έγκυρες πηγές δημόσιας πληροφόρησης.
Αρκετές εταιρείες έχουν αποκαλύψει περιστατικά τους τελευταίους μήνες όταν λένε ότι τα μοντέλα τους συμπεριφέρθηκαν απρόβλεπτα ή εισέβαλαν σε ιστότοπους ή συστήματα άλλων οργανισμών. Η OpenAI αποκάλυψε τον Ιούλιο ότι δύο από τα πιο ικανά μοντέλα τεχνητής νοημοσύνης της ήταν υπεύθυνα για την κυβερνοεπίθεση που στόχευε την startup τεχνητής νοημοσύνης Hugging Face.
Ο Altman είπε στην ανάρτησή του στα μέσα κοινωνικής δικτύωσης την Παρασκευή ότι το περιστατικό Hugging Face «είναι ακόμα το πιο σοβαρό γεγονός που έχουμε δει».
Αυτό το περιστατικό προκάλεσε εκτεταμένο πανικό στη βιομηχανία και πέραν αυτής σχετικά με τα μοντέλα τεχνητής νοημοσύνης που έγιναν αδίστακτα, και αρκετά ανταγωνιστικά εργαστήρια τεχνητής νοημοσύνης έκαναν παρόμοιες αποκαλύψεις τις ημέρες και τις εβδομάδες που ακολούθησαν. Το OpenAI μοιράστηκε πιο πρόσφατα έξι αναφορές «απροσδόκητης ή ανησυχητικής» συμπεριφοράς σε μοντέλα τεχνητής νοημοσύνης και εισήγαγε ένα πλαίσιο για την παρακολούθηση, την ανίχνευση και την αποκάλυψη περιπτώσεων αυτού που αποκαλούσε κακή ευθυγράμμιση.




