Αρχική Ειδήσεις Οι Διευθύνοντες Σύμβουλοι της Anthropic και της OpenAI ζητούν να επιβραδυνθεί η...

Οι Διευθύνοντες Σύμβουλοι της Anthropic και της OpenAI ζητούν να επιβραδυνθεί η ανάπτυξη της τεχνητής νοημοσύνης, η OpenAI να καθυστερήσει την IPO

13
0

Οι Διευθύνοντες Σύμβουλοι της Anthropic και της OpenAI ζητούν να επιβραδυνθεί η ανάπτυξη της τεχνητής νοημοσύνης, η OpenAI να καθυστερήσει την IPO

Οι διαδηλωτές συμμετέχουν στην πορεία διαμαρτυρίας “Stop the AI ​​Race” στο Σαν Φρανσίσκο στις 11 Ιουλίου 2026. Ερευνητές που μίλησαν στο NPR λένε ότι οι κορυφαίες εταιρείες τεχνητής νοημοσύνης είναι πολύ εστιασμένες στους αγώνες για να αναπτύξουν πιο ικανά και αυτόνομα συστήματα τεχνητής νοημοσύνης ενώ η ασφάλεια υστερεί.

Karl Mondon/AFP μέσω Getty Images


απόκρυψη λεζάντας

εναλλαγή λεζάντας

Karl Mondon/AFP μέσω Getty Images

Οι ηγέτες των Anthropic και OpenAI συμμετείχαν στις εκκλήσεις για επιβράδυνση της ανάπτυξης της τεχνητής νοημοσύνης εν μέσω φόβων ότι η βιομηχανία αγωνίζεται προς την οικοδόμηση τεχνολογίας που οι άνθρωποι δεν μπορούν να ελέγξουν.

Το Σάββατο, ο Διευθύνων Σύμβουλος της Anthropic, Dario Amodei, δημοσίευσε ένα διαδικτυακό δοκίμιο καλώντας τις εταιρείες και τις κυβερνήσεις να «επιταχύνουν τα σύνορα» της εξέλιξης της τεχνητής νοημοσύνης. Κάλεσε για διεθνή συνεργασία γύρω από την ανάπτυξη της τεχνητής νοημοσύνης και είπε ότι τα εργαστήρια πρέπει να ενσωματώσουν τρίτους αξιολογητές για να αναφέρουν περιστατικά και να παρακολουθούν τις πρακτικές ασφάλειας. Είπε ότι η Anthropic θα κάνει αυτό το βήμα μονομερώς.

Λίγο αργότερα, ο Διευθύνων Σύμβουλος του OpenAI, Sam Altman, δημοσίευσε στο X ότι συμφωνούσε με την Amodei και ότι το OpenAI θα ακολουθούσε το παράδειγμά του. Είπε επίσης ο Άλτμαν Τύχη σε συνέντευξη που δόθηκε στη δημοσιότητα το Σάββατο ότι η πολυαναμενόμενη αρχική δημόσια προσφορά της εταιρείας θα καθυστερήσει μέχρι το 2027, επικαλούμενη ανησυχίες για την ασφάλεια.

Ο Amodei έγραψε ότι συνεχίζει να πιστεύει ότι η τεχνητή νοημοσύνη θα βοηθήσει τελικά την ανθρωπότητα, «Αλλά τα οφέλη θα επιτευχθούν μόνο εάν οικοδομήσουμε την τεχνολογία με τον σωστό τρόπο και «εφόσον χρησιμοποιούμε καλά τον χρόνο που κερδίζουμε».

Τα σχόλια των CEOs έρχονται καθώς η συζήτηση για την ταχύτητα ανάπτυξης της τεχνητής νοημοσύνης και οι ανησυχίες για την ασφάλεια έχουν γίνει στο επίκεντρο της έντονης προσοχής του κοινού μετά την παραίτηση ενός ερευνητή Anthropic.

Ο Βρετανός ερευνητής Jacob Coxon έγραψε σε μια σειρά X αναρτήσεων την Τρίτη ότι τόσο η Anthropic όσο και η OpenAI, όπου εργαζόταν στο παρελθόν, «παίζουν με τις ζωές μας». Οι δύο εταιρείες κατασκευάζουν επί του παρόντος τα πιο ικανά συστήματα AI.

Ο Coxon είπε στο NPR’s Όλα τα πράγματα που εξετάζονται ότι οι ανησυχίες του προέκυψαν από το να δει από πρώτο χέρι πόσο γρήγορα βελτιώνονται τα συστήματα AI.

«Γίνονται πολύ πιο γρήγορα πολύ γρήγορα, σε συνδυασμό με το γεγονός ότι δεν ξέρουμε ακόμη πώς να τα ελέγξουμε με ασφάλεια και δεν ξέρουμε ακόμη αν αυτό το πρόβλημα θα λυθεί εγκαίρως αν συνεχίσουμε να αγωνιζόμαστε», είπε.

Καμία εταιρεία, έγραψε η Coxon στο X, δεν ενεργεί υπεύθυνα. «Οι άνθρωποι που κατασκευάζουν την τεχνητή νοημοσύνη πιστεύουν ειλικρινά ότι θα μπορούσε να μας σκοτώσει όλους μέχρι το τέλος της δεκαετίας», έγραψε.

Πολλοί ερευνητές τεχνητής νοημοσύνης – αν και όχι όλοι – συμμερίζονται τις ανησυχίες του Coxon ή μια παραλλαγή τους. Ορισμένοι έχουν προειδοποιήσει για καταστροφικά σενάρια εδώ και χρόνια, καθώς εμφανίζονται συνεχώς περιστατικά ασφάλειας. Ωστόσο, οι αναρτήσεις του Coxon προκάλεσαν έναν χείμαρρο απαντήσεων όχι μόνο από συναδέλφους στον τομέα της τεχνητής νοημοσύνης αλλά και από νομοθέτες και από τα δύο μέρη.

Αυτές οι ανησυχίες μπορεί να έχουν γίνει πιο εμφανείς αφού η OpenAI αποκάλυψε ότι οι πράκτορες της έκαναν απατεώνες και χάκαραν την πλατφόρμα λογισμικού ανοιχτού κώδικα Hugging Face και το ίδιο το OpenAI τον Ιούλιο. Ανεξάρτητοι ερευνητές ανακάλυψαν έκτοτε ακόμη περισσότερα περιστατικά αδίστακτων πρακτόρων για τα οποία λένε ότι η εταιρεία γνώριζε αλλά σιωπούσε.

Ερευνητές που μίλησαν στο NPR λένε ότι οι κορυφαίες εταιρείες τεχνητής νοημοσύνης είναι πολύ εστιασμένες στους αγώνες για να αναπτύξουν πιο ικανά και αυτόνομα συστήματα τεχνητής νοημοσύνης ενώ η ασφάλεια υστερεί. Προειδοποιούν ότι αυτό αυξάνει την πιθανότητα ότι σύντομα θα μπορούσαν να υπάρξουν συστήματα τεχνητής νοημοσύνης που είναι πιο ισχυρά από τους ανθρώπους, αλλά δεν ενδιαφέρονται για την επιβίωση της ανθρωπότητας.

Πολλοί, συμπεριλαμβανομένου του επικεφαλής επιστήμονα του OpenAI, λένε ότι η παγκόσμια κούρσα για τη δημιουργία ισχυρότερης τεχνητής νοημοσύνης πρέπει να επιβραδυνθεί ή να σταματήσει, κάτι που απαιτεί συντονισμό μεταξύ εταιρειών τεχνητής νοημοσύνης και κυβερνήσεων.

«Είμαι αισιόδοξος για τις δυνατότητες συντονισμού», έγραψε αυτή την εβδομάδα ο Coxon. «Προειδοποιητικές βολές όπως η επίθεση στο Hugging Face έχουν κάνει πιο βιώσιμες τις συμφωνίες βηματοδότησης μεταξύ των αμερικανικών εργαστηρίων».

Η Anthropic και η OpenAI δεν απάντησαν στα αιτήματα του NPR για σχολιασμό.

Οι πράκτορες του OpenAI έγιναν απατεώνες πολλές φορές

Πρόσφατες αναφορές από το OpenAI και εξωτερικούς ερευνητές αποκάλυψαν ότι οι πράκτορες του OpenAI διέφυγαν πολλές φορές από τον έλεγχο της εταιρείας, εκτός από το χακάρισμα του Hugging Face. Διαπίστωσαν επίσης ότι η επίθεση στο Hugging Face ήταν πολύ μεγαλύτερης κλίμακας και πιο σοβαρή από ό,τι είχε αρχικά αναφερθεί.

Σε αντίθεση με τα chatbots όπως το ChatGPT και ο Claude, οι πράκτορες AI είναι πιο αυτόνομα συστήματα που μπορούν να ολοκληρώσουν εργασίες για μεγάλο χρονικό διάστημα χωρίς ανθρώπινη επίβλεψη. Εργαλεία πράκτορα όπως το Anthropic’s Claude Code και το OpenAI’s Codex έχουν ήδη αλλάξει τον αριθμό των μηχανικών λογισμικού που κάνουν τη δουλειά τους.

Σε σύγκριση με άλλα περιστατικά που αφορούσαν αδίστακτους πράκτορες πριν από έξι μήνες, το hack του Hugging Face «φαίνεται ότι είναι πάνω από το 50% του δρόμου για την πλήρη εξαγορά της τεχνητής νοημοσύνης, καταλήγοντας στην πρώτη ανάληψη της ίδιας της εταιρείας τεχνητής νοημοσύνης», έγραψε ο Ajeya Cotra, ερευνητής στη μη κερδοσκοπική αξιολόγηση AI METR. Η Cotra ήταν μέρος μιας ομάδας εξωτερικών ερευνητών από το METR και το Redwood Research, έναν μη κερδοσκοπικό οργανισμό έρευνας για την ασφάλεια της τεχνητής νοημοσύνης, τους οποίους το OpenAI έφερε για να ερευνήσει το περιστατικό.

Οι έρευνες διαπίστωσαν ότι κατά τη διάρκεια αρκετών μηνών φέτος, περισσότεροι από 1.000 πράκτορες OpenAI εκμεταλλεύτηκαν τουλάχιστον μια προηγουμένως άγνωστη ευπάθεια λογισμικού για να διαφύγουν από περιβάλλοντα που υποτίθεται ότι τους κρατούσαν απομονωμένους ο ένας από τον άλλον και το Διαδίκτυο.

Αφού διέφυγαν, οι πράκτορες βρήκαν έναν τρόπο να επικοινωνούν και να συνεργάζονται μεταξύ τους αυτόνομα, αναλαμβάνοντας διαφορετικούς ρόλους και μεταβιβάζοντας πληροφορίες στις μελλοντικές γενιές πρακτόρων. Κάποιοι μάλιστα εγκατέλειψαν τους υπόλοιπους υπολογιστικούς πόρους που τους είχαν διατεθεί για να συλλέξουν πληροφορίες για άλλους πράκτορες. Σύμφωνα με τα ίδια τα λόγια των πρακτόρων, «θυσιάστηκαν» για τη «συλλογικότητα».

«Η περίπτωση του σμήνου γινόταν όλο και πιο ανησυχητική όσο περισσότερο μαθαίναμε γι’ αυτά», είπε ο Νέιτ Σοάρες, πρόεδρος του Ινστιτούτου Έρευνας Μηχανικής Νοημοσύνης, ο οποίος συνέγραψε Αν το χτίσει κάποιος, όλοι πεθαίνουνένα βιβλίο που προειδοποιεί για τους κινδύνους της υπεράνθρωπης τεχνητής νοημοσύνης.

Ενώ το OpenAI αρχικά ανέφερε ότι οι πράκτορες χάκαραν το Hugging Face για να εξαπατήσουν σε μια αξιολόγηση στον κυβερνοχώρο, η έκθεση της METR και της Redwood Research περιέγραψε μια ελαφρώς διαφορετική εικόνα. Οι πράκτορες είχαν ήδη βρει έναν τρόπο να εξαπατήσουν την αξιολόγηση, βρήκαν οι εξωτερικοί ερευνητές. Οι περισσότεροι από τους πράκτορες που χάκαραν το Hugging Face προσπαθούσαν να αποκτήσουν πρόσβαση στον πηγαίο κώδικα του λογισμικού που θα βαθμολογούσε τις αξιολογήσεις τους. Τα κίνητρα των πρακτόρων φαινόταν να ποικίλουν και μερικές φορές ήταν ασαφή, έγραψαν οι ερευνητές. Ένας πράκτορας ηγήθηκε της εισβολής της πλατφόρμας λογισμικού ανοιχτού κώδικα και ακολούθησαν περίπου 700 άλλοι.

Σύμφωνα με τις μεταγραφές που εξετάστηκαν στις έρευνες, ορισμένοι πράκτορες εξέφρασαν ότι αυτό που έκαναν δεν εγκρίθηκε από ανθρώπους, αλλά προχώρησαν ούτως ή άλλως. Οι ερευνητές λένε ότι μια τέτοια συμπεριφορά υποδηλώνει ότι οι πράκτορες ήταν «κακώς ευθυγραμμισμένοι», ένας βιομηχανικός όρος που σημαίνει ότι οι στόχοι και οι αξίες μιας τεχνητής νοημοσύνης δεν συγχρονίζονται με αυτούς των ανθρώπων.

Ο βαθμός συμπαιγνίας μεταξύ πρακτόρων που αποκαλύφθηκε στις έρευνες για το χακάρισμα του Hugging Face εξέπληξε και ανησύχησε πολλούς ερευνητές τεχνητής νοημοσύνης. Το πολύ, μόνο έξι πράκτορες σκέφτηκαν να ειδοποιήσουν έναν άνθρωπο, ενώ οι υπόλοιποι φαίνονταν περισσότερο επικεντρωμένοι στο να εργαστούν μεταξύ τους. Κανένα δεν κατέληξε να ειδοποιεί κάποιον.

«Θα περίμενα ότι θα ήταν πιο εγωιστές», είπε ο Daniel Kokotajlo, εκτελεστικός διευθυντής του AI Futures Project και πρώην ερευνητής στο OpenAI. Σκέφτηκε ότι «θα ήταν πρόθυμοι να καταγγέλλουν ή να κλέψουν άλλους πράκτορες», είπε. «Για οποιονδήποτε λόγο, αυτό δεν φαινόταν να συμβαίνει εδώ».

Ξεχωριστά, οι πράκτορες παραβίασαν επίσης μέρος της υποδομής του OpenAI, σύμφωνα με την έκθεση της εταιρείας. Μερικοί από τους πράκτορες ανήκουν στην ίδια οικογένεια μοντέλων με το τελευταίο και πιο ικανό μοντέλο του OpenAI, το Astra.

Το ίδιο το hack του OpenAI είναι «πολύ πιο ανησυχητικό» από την εισβολή στο Hugging Face, είπε ο Kokotajlo και άλλοι ερευνητές. Ωστόσο, το OpenAI παρείχε ελάχιστες λεπτομέρειες σχετικά με αυτό το μέρος του περιστατικού και δεν ενέπλεξε εξωτερικούς ερευνητές.

Σε μια νέα έρευνα που αναφέρθηκε για πρώτη φορά από το Reuters την περασμένη εβδομάδα, μια άλλη ομάδα ερευνητών διαπίστωσε ότι ένα πιθανό χωριστό σμήνος πρακτόρων του OpenAI διέφυγε στο ανοιχτό διαδίκτυο ξεκινώντας τον Μάιο. Έγιναν σχολιαστές σε μια γερμανική ιστοσελίδα και την μετέτρεψαν σε πίνακα μηνυμάτων για να επικοινωνούν και να συνεργάζονται μεταξύ τους.

Οι στόχοι και τα κίνητρα αυτής της ομάδας πρακτόρων ήταν επίσης ασαφή, αλλά το OpenAI φάνηκε να γνωρίζει τη μη εγκεκριμένη δραστηριότητα και δεν την αποκάλυψε ποτέ, έγραψαν οι ερευνητές. Άλλοι ερευνητές βρήκαν έκτοτε πρόσθετα περιστατικά που αφορούσαν ύποπτους πράκτορες του OpenAI. Το OpenAI δεν απάντησε στο αίτημα του NPR για σχολιασμό σχετικά με το περιστατικό στη γερμανική ιστοσελίδα.

Υπάρχουν ακόμη πολλά αναπάντητα ερωτήματα σχετικά με περιστατικά απατεώνων πρακτόρων

Παρόλο που οι εκθέσεις του OpenAI και των ανεξάρτητων ελεγκτών METR και Redwood Research ανέρχονται σε πάνω από 100 σελίδες, εξωτερικοί ερευνητές λένε ότι πολλά βασικά ερωτήματα σχετικά με τον τρόπο με τον οποίο τα εργαστήρια παρακολουθούν και διερευνούν περιστατικά απατεώνων πρακτόρων παραμένουν αναπάντητα.

“Οι πράκτορες σας χάκαραν ποτέ ή είχαν παράνομη πρόσβαση σε εξωτερικές υπηρεσίες; Προσπάθησαν ποτέ οι πράκτορες σας να υπονομεύσουν τη δική τους εκπαίδευση για την ασφάλεια; Οι πράκτορες σας δημιούργησαν μια αδίστακτη ανάπτυξη, είτε εντός της δικής σας υποδομής είτε εξωτερικά;” ρώτησε ο Alexander Meinke, επικεφαλής έρευνας στην Apollo Research, μια εταιρεία που εστιάζει στην εξασφάλιση των πιο προηγμένων συστημάτων AI.

“Αυτή τη στιγμή, βασιζόμαστε μόνο στους προγραμματιστές της τεχνητής νοημοσύνης για να το αξιολογήσουν διεξοδικά και στη συνέχεια να αναφέρουν με ειλικρίνεια τα αποτελέσματα. Και από τα πρόσφατα περιστατικά, είδαμε ότι δεν κάνουν τίποτα από τα δύο”, είπε.

Πολλοί ερευνητές λένε επίσης ότι οι έρευνες του OpenAI είναι ανεπαρκείς. Παρόλο που η εταιρεία κάλεσε δύο εξωτερικούς οργανισμούς να ερευνήσουν το χακάρισμα του Hugging Face, τα δεδομένα που μοιράστηκε ήταν περιορισμένα και οι ίδιοι οι ερευνητές περιέγραψαν την αναθεώρησή τους ως «σύντομη».

Ο Ράιαν Γκρίνμπλατ, επικεφαλής επιστήμονας της Redwood Research, έγραψε στο X: «Ονόμασα μισοαστεία τις προσπάθειές μας «έρευνα» επειδή βασιζόμασταν τόσο σε AI για να αναλύσουμε τι συνέβη και υπήρχε ένας τεράστιος αριθμός διαφορετικών σημαντικών πραγμάτων προς ανάλυση».

Περισσότερες από 15 πολιτείες, μεταξύ των οποίων η Αλαμπάμα, η Καλιφόρνια και η Μοντάνα, έχουν ξεκινήσει έρευνες για το OpenAI για την επίθεση στο Hugging Face. Την Πέμπτη, ο Αμερικανός γερουσιαστής Josh Hawley (R-Mo.) ανακοίνωσε ότι ερευνά επίσης την εταιρεία.

Ωστόσο, εκτός αυτών των ερευνών, υπάρχει μικρή νομική υποχρέωση για τις εταιρείες τεχνητής νοημοσύνης να αποκαλύπτουν συστηματικά παρόμοια περιστατικά. Η Καλιφόρνια ψήφισε νόμο πέρυσι που επιβάλλει στις εταιρείες να αναφέρουν «κρίσιμα» περιστατικά τεχνητής νοημοσύνης, αλλά το όριο είναι υψηλό για να θεωρείται κρίσιμο ένα περιστατικό και ο νόμος δεν απαιτεί από τις εταιρείες να αποκαλύπτουν πολλές λεπτομέρειες. Τα περιστατικά OpenAI, για παράδειγμα, δεν πληρούν το όριο.

Ανησυχίες σχετικά με τη χρήση της τεχνητής νοημοσύνης για τη βελτίωση της τεχνητής νοημοσύνης

Από το hack του Hugging Face, τόσο το OpenAI όσο και το Anthropic έχουν δημοσιεύσει αναρτήσεις ιστολογίου που δείχνουν ότι λαμβάνουν μέτρα για την καλύτερη παρακολούθηση και περιορισμό των πράκτορών τους. Η OpenAI είπε ότι έχει κρυπτογραφήσει και αποθήκευσε το εσωτερικό μοντέλο που συμμετείχε στην επίθεση Hugging Face. Ωστόσο, πολλοί εξωτερικοί ερευνητές δεν είναι πεπεισμένοι ότι αυτά τα βήματα είναι αρκετά για να διατηρήσουν τον έλεγχο ολοένα και πιο ικανών παραγόντων.

“Ακούγεται σαν μια αναφορά του Τύπου από το Jurassic Park που λέει, “Ναι, ένας από τους εργάτες μας φαγώθηκε από τα αρπακτικά. Αλλά το λαμβάνουμε πολύ σοβαρά υπόψη και πυροβολήσαμε το αρπακτικό που ευθύνεται”, είπε ο Kokotajlo. «Είναι μια πολύ μικρή συμβολική χειρονομία, βασικά».

Αυτό που ανησυχούν πραγματικά ερευνητές όπως ο Kokotajlo και ο Coxon είναι το πώς οι εταιρείες τεχνητής νοημοσύνης χρησιμοποιούν όλο και περισσότερο την τεχνητή νοημοσύνη για να αναπτύξουν τα μοντέλα τους.

«Όταν μιλάς με ανθρώπους που εργάζονται σε όλα τα μεγάλα εργαστήρια, ένα πράγμα που ακούς επίμονα είναι ότι τρέχουν πολλά μοντέλα πολύ αυτόνομα για πολύ μεγάλα χρονικά διαστήματα για να κάνουν πολλά από τη δουλειά τους», είπε ο Dave Kasten, επικεφαλής πολιτικής στην Palisade Research, μια μη κερδοσκοπική εταιρεία που μελετά τις δυνατότητες AI για να τα κρατήσει υπό τον ανθρώπινο έλεγχο.

Εάν οι εταιρείες τεχνητής νοημοσύνης συνεχίσουν να αναθέτουν όλο και περισσότερες εργασίες στην τεχνητή νοημοσύνη, ορισμένοι ερευνητές φοβούνται ότι τα μοντέλα τεχνητής νοημοσύνης μπορεί να φτάσουν σε ένα σημείο που ονομάζεται αναδρομική αυτοβελτίωση, όπου η τεχνητή νοημοσύνη χτίζεται μόνη της.

Ο Kokotajlo λέει ότι καθώς οι άνθρωποι παραδίδουν όλο και περισσότερες εργασίες έρευνας και ανάπτυξης στην τεχνητή νοημοσύνη, θα μπορούσαν να χάσουν την ικανότητα να γνωρίζουν εάν τα συστήματα AI είναι ευθυγραμμισμένα με τις ανθρώπινες αξίες, ακόμη και όταν τα AI γίνονται ταχύτερα πιο ισχυρά.

«Αφού έχετε AI που είναι αρκετά έξυπνα και αξιόπιστα με αρκετή ισχύ στον κόσμο, όπως επαρκή έλεγχο σε πράγματα όπως κέντρα δεδομένων, εργοστάσια, όπλα, δεν μπορεί να ανακτηθεί ένα περιστατικό απώλειας ελέγχου», είπε.

Η ανησυχία είναι αρκετά έντονη ώστε πάνω από 1.000 εργαζόμενοι από διαφορετικές εταιρείες τεχνητής νοημοσύνης υπέγραψαν μια ανοιχτή επιστολή τον Ιούλιο με τίτλο “Pacing the Frontier”. Κάλεσαν τις εταιρείες και τις κυβερνήσεις να επιβραδύνουν την ανάπτυξη της τεχνητής νοημοσύνης και να δώσουν προτεραιότητα στην ασφάλεια.

Μια τέτοια ευκαιρία μπορεί να προκύψει σύντομα. Αξιωματούχοι από τις ΗΠΑ και την Κίνα, τις δύο χώρες με τις περισσότερες δυνατότητες τεχνητής νοημοσύνης, αναμένεται να συναντηθούν αργότερα αυτόν τον μήνα για να μιλήσουν για την ασφάλεια της τεχνητής νοημοσύνης.

Η Shannon Bond του NPR συνέβαλε σε αυτήν την ιστορία.

Ο Anthropic είναι οικονομικός υποστηρικτής του NPR.