Εντονη ανησυχία στο εσωτερικό της Anthropic για την πορεία προς την υπερνοημοσύνη- ερευνητής παραιτείται καταγγέλλοντας ότι η βιομηχανία «παίζει με τις ζωές μας» .Ο επικεφαλής της επιστήμης ευθυγράμμισης εκτιμά πάνω από 10% την πιθανότητα η AI να οδηγήσει στην εξόντωση της ανθρωπότητας μέσα στην επόμενη δεκαετία.
Η συζήτηση για τους κινδύνους της τεχνητής νοημοσύνης περνά πλέον σε ένα διαφορετικό επίπεδο. Δεν πρόκειται μόνο για προειδοποιήσεις ακαδημαϊκών, ακτιβιστών ή εξωτερικών επικριτών των μεγάλων εταιρειών τεχνολογίας. Τις τελευταίες ημέρες, δύο ερευνητές που έχουν εργαστεί στην πρώτη γραμμή της ανάπτυξης προηγμένων μοντέλων τεχνητής νοημοσύνης έθεσαν δημοσίως ένα πολύ πιο δύσκολο ερώτημα:
Τι συμβαίνει εάν η πρόοδος των μοντέλων επιταχυνθεί τόσο γρήγορα, ώστε η έρευνα για την ασφάλεια και τον έλεγχό τους να μην προλαβαίνει πλέον να ακολουθήσει;
Το ερώτημα αυτό βρίσκεται πίσω από την παραίτηση του ερευνητή Jacob Coxon από την Anthropic, αλλά και από μια ιδιαίτερα ανησυχητική παρέμβαση του Evan Hubinger, επικεφαλής της επιστήμης ευθυγράμμισης της εταιρείας.
Ο Hubinger δήλωσε δημοσίως ότι ο ίδιος και συνάδελφοί του πιστεύουν πραγματικά πως η τεχνητή νοημοσύνη θα μπορούσε να οδηγήσει στην εξόντωση της ανθρωπότητας και εκτίμησε ότι η πιθανότητα ενός τέτοιου σεναρίου ξεπερνά το 10% μέσα στην επόμενη δεκαετία.
Η δήλωση έχει ιδιαίτερη βαρύτητα όχι επειδή αποτελεί επίσημη πρόβλεψη της Anthropic, αλλά επειδή προέρχεται από έναν ερευνητή που ασχολείται ακριβώς με το πρόβλημα που περιγράφει: το AI alignment, δηλαδή την προσπάθεια να διασφαλιστεί ότι οι στόχοι και η συμπεριφορά ενός πολύ ισχυρού συστήματος θα παραμένουν συμβατοί με τις ανθρώπινες προθέσεις και αξίες.
Jacob is correct here—we really do earnestly believe AI could kill all humans! I personally think it is >10% within the next decade. I believe Anthropic is trying its best, but we do not yet have a plan to solve alignment for superintelligence and are not clearly on track to. https://t.co/QAIHiFP3QZ
— Evan Hubinger (@EvanHub) September 9, 2026
«Δεν έχουμε ακόμη λύσει το πρόβλημα»
Ο Hubinger δεν υποστήριξε ότι τα σημερινά μοντέλα αποτελούν άμεση απειλή για την ανθρωπότητα. Αντίθετα, επικαλέστηκε την ίδια την έρευνα της Anthropic, σύμφωνα με την οποία ο κίνδυνος από τα σημερινά συστήματα παραμένει χαμηλός, αν και όχι μηδενικός.
Η ανησυχία του αφορά το επόμενο στάδιο.
Σε μεταγενέστερη ανάρτησή του, αναφέρθηκε στην αναδρομική αυτοβελτίωση (recursive self-improvement): την πιθανότητα ένα σύστημα τεχνητής νοημοσύνης να αποκτήσει αρκετές ικανότητες ώστε να βοηθά στην ανάπτυξη, εκπαίδευση και βελτίωση της επόμενης γενιάς συστημάτων.
Αν ένας κύκλος αυτού του είδους γίνει αρκετά αυτοματοποιημένος, η ανθρώπινη συμμετοχή θα μπορούσε σταδιακά να μειωθεί.
I resigned from Anthropic today. I spent the last three years doing pretraining research at both OpenAI and Anthropic. Neither company is acting responsibly. They are racing straight to self-improving superintelligence and gambling with our lives. More thoughts below.
— Jacob Coxon (@hilbertspaess) September 9, 2026
Και εδώ βρίσκεται ο πυρήνας του προβλήματος.
Η Anthropic αναγνωρίζει πλέον ανοιχτά ότι η τεχνολογία κινείται προς αυτή την κατεύθυνση. Σε πρόσφατη έκθεσή της με τίτλο «When AI builds itself», η εταιρεία περιγράφει την προοπτική ενός συστήματος που θα μπορεί, με αρκετή υπολογιστική ισχύ, να σχεδιάζει και να αναπτύσσει αυτόνομα τον διάδοχό του. Η εταιρεία τονίζει ότι αυτό δεν έχει συμβεί ακόμη και ότι δεν είναι αναπόφευκτο, αλλά προειδοποιεί ότι μπορεί να έρθει νωρίτερα από όσο είναι προετοιμασμένοι οι ειδικοί.
Η ίδια έκθεση καταγράφει ενδείξεις ότι η AI επιταχύνει ήδη την ίδια την ανάπτυξη της AI. Σύμφωνα με την Anthropic, οι μηχανικοί της παράγουν πλέον κατά μέσο όρο περίπου οκταπλάσιο όγκο κώδικα ανά τρίμηνο σε σχέση με την περίοδο 2021-2025. Παράλληλα, η εταιρεία αναφέρει ότι η διάρκεια των εργασιών που μπορούν να ολοκληρώσουν αξιόπιστα τα μοντέλα αυτόνομα έχει περίπου διπλασιαστεί κάθε τέσσερις μήνες, έναντι περίπου επτά μηνών στην προηγούμενη περίοδο.

Η παραίτηση βόμβα του Jacob Coxon
Μέσα σε αυτό το κλίμα, ο Jacob Coxon ανακοίνωσε την αποχώρησή του από την Anthropic.Ο Coxon, ο οποίος είχε προηγουμένως εργαστεί και στην OpenAI, υποστήριξε ότι η βιομηχανία κινείται προς την ανάπτυξη αυτοβελτιούμενης υπερνοημοσύνης πολύ ταχύτερα από όσο επιτρέπει η πρόοδος στην ασφάλεια.
Σε αναρτήσεις του στο X υποστήριξε ότι οι εταιρείες «σπεύδουν κατευθείαν» προς την αυτοβελτιούμενη υπερνοημοσύνη και ότι ουσιαστικά «παίζουν με τις ζωές μας». Η Wall Street Journal μετέδωσε ότι ο Coxon θεωρεί πιθανό να βρεθεί ο κόσμος αντιμέτωπος με ιδιαίτερα επιθετικά σενάρια μέσα σε πολύ σύντομο χρονικό διάστημα.
Το ενδιαφέρον είναι ότι η κριτική του προς την Anthropic δεν είναι απλώς ότι η εταιρεία αγνοεί τους κινδύνους.
Η θέση του είναι πιο σύνθετη: η Anthropic κατανοεί τους κινδύνους, αλλά ακριβώς επειδή τους κατανοεί φοβάται ότι πρέπει να συνεχίσει την κούρσα ώστε να μη βρεθεί πίσω από μια ανταγωνίστρια εταιρεία που μπορεί να είναι λιγότερο προσεκτική.
Πρόκειται για ένα από τα σημαντικότερα προβλήματα συντονισμού στην ανάπτυξη της προηγμένης AI.
Εάν μία εταιρεία επιβραδύνει μόνη της, ενώ οι ανταγωνιστές της συνεχίζουν, μπορεί να χάσει τεχνολογικό έδαφος. Εάν όμως όλες συνεχίζουν να επιταχύνουν επειδή φοβούνται ότι θα μείνουν πίσω, τότε δημιουργείται ένας αγώνας δρόμου στον οποίο το κίνητρο κάθε μεμονωμένης εταιρείας οδηγεί συνολικά σε μεγαλύτερο ρίσκο.
Η «κούρσα» προς την υπερνοημοσύνη
Κατά την άποψή του, τα κορυφαία εργαστήρια AI έχουν πλέον φτάσει σε ένα σημείο όπου δεν ανταγωνίζονται απλώς για ένα καλύτερο chatbot ή έναν πιο αποτελεσματικό προγραμματιστικό βοηθό. Ο ανταγωνισμός αφορά το ποιος θα φτάσει πρώτος σε συστήματα που μπορούν να εκτελούν ολοένα μεγαλύτερο μέρος της πνευματικής εργασίας ενός ανθρώπου.
Και όσο περισσότερες εργασίες μπορούν να εκτελούν αυτόνομα τα μοντέλα, τόσο περισσότερο μπορούν να χρησιμοποιηθούν για να επιταχύνουν την ίδια την έρευνα AI.
Αυτό δημιουργεί έναν πιθανό βρόχο: Kαλύτερα μοντέλα = περισσότερη αυτοματοποίηση έρευνας= ταχύτερη ανάπτυξη νέων μοντέλων = ακόμη καλύτερα μοντέλα.
Εάν ο βρόχος αυτός συνεχίζει με αυτή την ιλιγγιώδη ταχύτητα , το κρίσιμο ερώτημα δεν θα είναι πλέον αν ένα μοντέλο είναι καλύτερο από τον προκάτοχό του. Θα είναι αν οι άνθρωποι μπορούν ακόμη να κατανοήσουν, να ελέγξουν και να περιορίζουν όταν χρειαστεί τη τεχνητη νοημοσύνη .
Το πρόβλημα του alignment
Εδώ βρίσκεται η τεχνική έννοια που επανέρχεται συνεχώς στις τελευταίες προειδοποιήσεις: alignment.
Σε απλή μορφή, το πρόβλημα είναι να εξασφαλιστεί ότι ένα πολύ ισχυρό σύστημα θα κάνει αυτό που πραγματικά θέλουν οι άνθρωποι και όχι απλώς αυτό που κατάφερε να καταλάβει ότι ανταμείβεται.
Η δυσκολία αυξάνεται όσο τα συστήματα γίνονται πιο αυτόνομα.Ένα μοντέλο που απαντά σε μια ερώτηση είναι σχετικά εύκολο να ελεγχθεί. Ένα σύστημα που γράφει κώδικα, χρησιμοποιεί εργαλεία, σχεδιάζει πειράματα, διαχειρίζεται υπολογιστικούς πόρους και συνεργάζεται με άλλα συστήματα έχει πολύ μεγαλύτερο περιθώριο για απρόβλεπτη συμπεριφορά.
Και αν ένα μελλοντικό σύστημα μπορεί να συμβάλλει στην εκπαίδευση του επόμενου μοντέλου, τότε το πρόβλημα της ευθυγράμμισης αποκτά μια νέα διάσταση: πρέπει να διασφαλιστεί όχι μόνο ότι το σημερινό μοντέλο είναι ασφαλές, αλλά ότι η διαδικασία που χρησιμοποιείται για να δημιουργηθεί το αυριανό μοντέλο παραμένει ασφαλής.
Η προειδοποίηση της OpenAI

Η ανησυχία δεν περιορίζεται στην Anthropic. Ο Jakub Pachocki, επικεφαλής επιστήμονας της OpenAI, δημοσίευσε στις 6 Σεπτεμβρίου ένα εκτενές κείμενο με τίτλο «An Alien Mind», στο οποίο υποστηρίζει ότι κανένα εργαστήριο δεν έχει επιλύσει το alignment και την παρακολούθηση σε βαθμό που να δικαιολογεί τη συνέχιση της ανάπτυξης με τη μέγιστη δυνατή ταχύτητα για πολύ περισσότερο.
Η θέση αυτή έχει ιδιαίτερη σημασία επειδή δεν προέρχεται από εξωτερικό επικριτή της βιομηχανίας, αλλά από τον επικεφαλής επιστήμονα ενός από τα ισχυρότερα εργαστήρια τεχνητής νοημοσύνης στον κόσμο.
Ο Pachocki τάσσεται υπέρ μιας μορφής εθελοντικής επιβράδυνσης μέχρι να δημιουργηθούν κοινά πρότυπα ασφάλειας και ζητά μεγαλύτερη διεθνή συνεργασία. Παράλληλα, υποστηρίζει ότι τα σημερινά συστήματα παρακολούθησης της συμπεριφοράς των μοντέλων δεν είναι βέβαιο ότι θα παραμείνουν αποτελεσματικά όσο τα μοντέλα γίνονται πιο ικανά.
Η παρέμβαση αυτή ενισχύει μια ιδιαίτερα ασυνήθιστη εικόνα: οι άνθρωποι που βρίσκονται στο εσωτερικό των κορυφαίων εργαστηρίων AI προειδοποιούν ότι η τεχνολογική πρόοδος μπορεί να εξελίσσεται ταχύτερα από την ικανότητά τους να την ελέγξουν.
Το παράδοξο της ασφάλειας
Η Anthropic έχει χτίσει μεγάλο μέρος της ταυτότητάς της γύρω από την ασφάλεια της AI. Η εταιρεία έχει αναπτύξει το δικό της Responsible Scaling Policy και δημοσιεύει έρευνα για τους κινδύνους από την αυτόνομη και μη ευθυγραμμισμένη συμπεριφορά των μοντέλων. Σε προηγούμενη έκθεσή της, είχε χαρακτηρίσει τον κίνδυνο από τα τότε μοντέλα ως πολύ χαμηλό αλλά όχι μηδενικό.
Ωστόσο, η σημερινή συζήτηση δείχνει το βασικό παράδοξο που αντιμετωπίζει η εταιρεία.Πρέπει να αναπτύξει την πιο προηγμένη AI για να έχει τη δυνατότητα να την κάνει ασφαλή, την ίδια στιγμή που η ίδια η ανάπτυξη της πιο προηγμένης AI μπορεί να δημιουργήσει τους κινδύνους που προσπαθεί να αποτρέψει.
Και αυτή δεν είναι μόνο η πρόκληση της Anthropic.Είναι το πρόβλημα ολόκληρης της βιομηχανίας.
Τι σημαίνουν όλα αυτά στην πράξη;
Χρειάζεται προσοχή ώστε οι δηλώσεις των ερευνητών να μην ερμηνευθούν ως πρόβλεψη ότι η ανθρωπότητα πρόκειται να εξαφανιστεί.
Ούτε ο Hubinger ούτε ο Coxon παρουσίασαν ένα συγκεκριμένο μοντέλο που βρίσκεται σήμερα κοντά στην εξόντωση της ανθρωπότητας. Ούτε υπάρχει επιστημονική συναίνεση ότι η καταστροφή είναι αναπόφευκτη.
Αυτό που αποτυπώνουν οι συγκεκριμένες δηλώσεις είναι κάτι διαφορετικό και ίσως πιο σημαντικό:
οι ίδιοι οι άνθρωποι που εργάζονται πάνω στα πιο προηγμένα συστήματα θεωρούν πλέον πιθανό ότι η πρόοδος μπορεί να φτάσει σε ένα σημείο όπου οι σημερινές μέθοδοι ελέγχου δεν θα επαρκούν.
Η Anthropic, μάλιστα, αναγνωρίζει στην πρόσφατη έρευνά της ότι η μετάβαση προς συστήματα που μπορούν να αναλαμβάνουν όλο και μεγαλύτερο μέρος της διαδικασίας ανάπτυξης AI μπορεί να έρθει νωρίτερα από όσο είναι προετοιμασμένοι οι θεσμοί.
Το κρίσιμο ερώτημα, επομένως, δεν είναι αν η τεχνητή νοημοσύνη θα «καταστρέψει τον κόσμο» αύριο.
Είναι αν η ανθρωπότητα θα έχει προλάβει να δημιουργήσει τους τεχνικούς, θεσμικούς και πολιτικούς μηχανισμούς ελέγχου πριν εμφανιστούν συστήματα που θα είναι πολύ πιο ικανά από τα σημερινά.
Και εδώ βρίσκεται ίσως το πιο ανησυχητικό συμπέρασμα από τις τελευταίες εξελίξεις:
οι άνθρωποι που βρίσκονται στην πρώτη γραμμή της ανάπτυξης της τεχνητής νοημοσύνης δεν λένε ότι γνωρίζουν πώς θα τελειώσει αυτή η κούρσα. Λένε ότι δεν είναι ακόμη βέβαιοι πως γνωρίζουν πώς να τη σταματήσουν….
all photos via pexels.com
Σχετικά άρθρα
- Τα 7 σημάδια που δείχνουν ότι ο έφηβος εθίστηκε στη τεχνητή νοημοσύνη
- Ρωτήσαμε το ChatGPT να μας πει: Πώς θα αλλάξει ο κόσμος σε 10 χρόνια από την τεχνητή νοημοσύνη; Η απάντηση είναι δυστοπική
- Μοντέλα τεχνητής νοημοσύνης της OpenAI ξέφυγαν από τον έλεγχο των δημιουργών τους και χάκαραν άλλη πλατφόρμα
- Τί θα γινόταν αν η τεχνητή νοημοσύνη αποκτούσε όντως συνείδηση;