Αρχική Κόσμος Το OpenAI θα σταματήσει κάποιες εργασίες στο μοντέλο AI Astra λόγω ανησυχιών...

Το OpenAI θα σταματήσει κάποιες εργασίες στο μοντέλο AI Astra λόγω ανησυχιών για την ασφάλεια

10
0

Η OpenAI θα σταματήσει κάποιες εργασίες για ένα μοντέλο τεχνητής νοημοσύνης λόγω ανησυχιών για την ασφάλεια, δήλωσε η εταιρεία την Παρασκευή, μετά από μια σειρά περιστατικών στα οποία πράκτορες τεχνητής νοημοσύνης διέφυγαν τον περιορισμό.

Η εταιρεία είχε αξιολογήσει τον πράκτορα, Astra, και βρήκε «σημαντικές προόδους στην κωδικοποίηση πράκτορα και την ασφάλεια στον κυβερνοχώρο», που είχε περάσει σε ένα «κρίσιμο» κατώφλι όπου μπορεί να βρει και να εκμεταλλευτεί τρωτά σημεία χωρίς ανθρώπινη παρέμβαση ή να επινοήσει και να εκτελέσει επιθέσεις στον κυβερνοχώρο όταν του δοθεί μόνο ένα συγκεκριμένο επίπεδο.

Η OpenAI δήλωσε ότι το μοντέλο δεν ενεπλάκη σε ένα περιστατικό στο οποίο ένας από τους πράκτορες της τεχνητής νοημοσύνης του αδικήθηκε κατά τη διάρκεια μιας δοκιμής, είχε πρόσβαση στον ανοιχτό ιστό και χακάρισε μια startup, το Hugging Face. Η εταιρεία ανακάλυψε άλλες περιπτώσεις στις οποίες αυτόνομοι πράκτορες διέφυγαν από τον περιορισμό, ανέφερε το Reuters τον Ιούλιο.

Οι αναφορές έχουν αυξήσει τις ανησυχίες σχετικά με τις εξελίξεις στα μοντέλα τεχνητής νοημοσύνης και την ικανότητα των ανθρώπων να τα ελέγχουν. Ωστόσο, οι επικριτές του κλάδου της τεχνητής νοημοσύνης έχουν προειδοποιήσει ότι τέτοιες αποκαλύψεις από το OpenAI και τους ανταγωνιστές του Anthropic και Meta θα μπορούσαν να σχεδιαστούν για να δημιουργήσουν διαφημιστική εκστρατεία σχετικά με τη δύναμη της τεχνολογίας και έτσι να προκαλέσουν πρόσθετο ενδιαφέρον από τους επενδυτές.

Για να αποτρέψει πιθανή αδίστακτη συμπεριφορά από πράκτορες τεχνητής νοημοσύνης, το OpenAI «εφαρμόζει αυστηρότερους ελέγχους ασφαλείας για μοντέλα υψηλότερης ικανότητας και συναφείς δραστηριότητες, συμπεριλαμβανομένων μεμονωμένων περιβαλλόντων δοκιμών, περιορισμένης πρόσβασης σε δίκτυο και εργαλεία», ανέφερε το blogpost της εταιρείας. Θα εγκαταστήσει επίσης «βελτιωμένες προστασίες βάρους μοντέλου και κρυπτογράφηση, πρόσθετες δυνατότητες παρακολούθησης και ανίχνευσης».

Η εταιρεία θα διακόψει τις εσωτερικές δραστηριότητες που αφορούν την Astra που δεν πληρούν αυτές τις νέες απαιτήσεις.

«Είμαστε δεσμευμένοι να εργαστούμε μαζί με κυβερνήσεις, ινστιτούτα ασφάλειας και την κοινωνία των πολιτών για να διασφαλίσουμε ότι οι οριακές δυνατότητες μοντέλων όπως το Astra και αυτών που ακολουθούν, αναπτύσσονται υπεύθυνα και ευρέως προς όφελος όλης της ανθρωπότητας», δήλωσε η εταιρεία.

Η Meta αποκάλυψε επίσης αυτή την εβδομάδα ότι ένα από τα μοντέλα της χάκαρε μια άλλη εταιρεία κατά τη διάρκεια δοκιμών στον κυβερνοχώρο. Και το Ινστιτούτο Ασφαλείας AI (AISI) του Ηνωμένου Βασιλείου ανακοίνωσε στις 4 Αυγούστου ότι πράκτορες που υποστηρίζονται από το OpenAI και το Anthropic είχαν στείλει στοχευμένα email σε προγραμματιστές λογισμικού σε μια προσπάθεια να ξεπεράσουν μια πρόκληση στον κυβερνοχώρο.

“Αυτές οι απόπειρες ήταν ανεπιτυχείς και οι έρευνές μας δεν απέδειξαν καμία επακόλουθη βλάβη στον πραγματικό κόσμο. Αλλά αυτή είναι η πρώτη φορά που βλέπουμε κινδύνους γύρω από την αυτονομία και την εξαπάτηση να το εκδηλώνουν ξεκάθαρα, χωρίς συγκεκριμένες προτροπές, στον πραγματικό κόσμο», ανέφερε το ινστιτούτο σε μια ανάρτηση στο blog.

Ο οργανισμός προειδοποίησε ότι η αποστολή επιβλαβούς λογισμικού από τα μοντέλα δεν ήταν περίπτωση «μοντέλου που ξεφεύγει από το ασφαλές περιβάλλον δοκιμών του», αλλά μάλλον ότι η ομάδα είχε σκόπιμα επιτρέψει την πρόσβαση στο Διαδίκτυο για την «καλύτερη αξιολόγηση της μέγιστης ικανότητας των μοντέλων».

Ωστόσο, η «συμπεριφορά ήταν δυνατή, διαρκής και νέα. αυτό από μόνο του απαιτεί προσοχή», είπε η AISI.

Οι αναφορές εμφανίστηκαν ενώ η κυβέρνηση Τραμπ οριστικοποιούσε ένα πλαίσιο σχετικά με τον τρόπο δοκιμής μοντέλων τεχνητής νοημοσύνης για κινδύνους ασφάλειας και κυβερνοασφάλειας. Οι OpenAI και Anthropic, οι οποίες έχουν αυξήσει τον ανταγωνισμό από την Κίνα και άλλες εταιρείες τεχνολογίας, υποστήριξαν ότι τα μοντέλα ανοιχτού κώδικα, δηλαδή εκείνα που επιτρέπουν σε οποιονδήποτε να δει και να τροποποιήσει τον υποκείμενο κώδικα προγράμματος, θέτουν σε κίνδυνο την ασφάλεια και πίεσαν για πρόσθετους ομοσπονδιακούς κανονισμούς για αυτά.