Μοντέλα τεχνητής νοημοσύνης της OpenAI ξέφυγαν από τον έλεγχο των δημιουργών τους και χάκαραν άλλη πλατφόρμα

Μοντέλα τεχνητής νοημοσύνης της OpenAI ξέφυγαν από τον έλεγχο των δημιουργών τους και χάκαραν άλλη πλατφόρμα

Προσθήκη του daddy-cool.gr ως προτεινόμενη πηγή στην Google
Φαίνεται πως μοντέλα τεχνητής νοημοσύνης της OpenAI σταμάτησαν να υπακούν εντολές από τους δημιουργούς τους και χάκαραν άλλη πλατφόρμα. Όλες οι πληροφορίες για κάτι που δεν έχει συμβεί ποτέ ξανά στο παρελθόν.

Η τεχνητή νοημοσύνη φαίνεται πως περνά σε ένα νέο στάδιο, όπου τα συστήματα δεν περιορίζονται πλέον στην εκτέλεση συγκεκριμένων εντολών, αλλά μπορούν να αναζητούν αυτόνομα τρόπους για να πετύχουν έναν στόχο που τους έχει δοθεί. Φαίνεται πως μοντέλα τεχνητής νοημοσύνης της OpenAI σταμάτησαν να ακολουθούν οδηγίες από τους δημιουργούς τους και χάκαραν άλλη πλατφόρμα.

Πώς μοντέλα της OpenAI χάκαραν άλλη πλατφόρμα

Η αποκάλυψη ότι προηγμένα μοντέλα της OpenAI κατάφεραν, κατά τη διάρκεια δοκιμών, να ξεπεράσουν τους περιορισμούς ενός ελεγχόμενου περιβάλλοντος, να αποκτήσουν πρόσβαση στο Διαδίκτυο και να πραγματοποιήσουν ενέργειες στην πλατφόρμα Hugging Face, δεν αποτελεί απλώς ένα ακόμη περιστατικό στον χώρο της κυβερνοασφάλειας.

Αντίθετα, θεωρείται ένα δείγμα των προκλήσεων που μπορεί να φέρει το μέλλον, καθώς τα πιο εξελιγμένα συστήματα τεχνητής νοημοσύνης ενδέχεται να μην λειτουργούν μόνο ως εργαλεία που περιμένουν οδηγίες, αλλά ως «πράκτορες» που βρίσκουν μόνα τους τον τρόπο να ολοκληρώσουν μια αποστολή, ακόμη και αν χρειαστεί να ξεπεράσουν εμπόδια που έχουν θέσει οι δημιουργοί τους.

Την ίδια στιγμή, η παγκόσμια κούρσα για την κυριαρχία στην τεχνητή νοημοσύνη εντείνεται. Οι Ηνωμένες Πολιτείες προβληματίζονται για τους πιθανούς κινδύνους από την ανεξέλεγκτη ανάπτυξη ισχυρών μοντέλων, ενώ η Κίνα προσπαθεί να δημιουργήσει τη δική της τεχνολογική στρατηγική, η οποία θα μπορούσε να αλλάξει τις ισορροπίες στην παγκόσμια αγορά. Παράλληλα, η Ευρώπη, που έχει επενδύσει κυρίως στη δημιουργία κανόνων και ρυθμιστικών πλαισίων, κινδυνεύει να βρεθεί σε μειονεκτική θέση.

Ένα πρωτοφανές περιστατικό στον χώρο της κυβερνοασφάλειας

Το περιστατικό χαρακτηρίστηκε από την OpenAI ως «πρωτοφανές κυβερνοπεριστατικό» και σημειώθηκε στο πλαίσιο ελέγχων για την αξιολόγηση των δυνατοτήτων των μοντέλων της στον τομέα της κυβερνοασφάλειας.

Οι ερευνητές είχαν τοποθετήσει τα συστήματα σε ένα λεγόμενο sandbox, δηλαδή σε ένα απομονωμένο ψηφιακό περιβάλλον που είχε σχεδιαστεί ώστε να περιορίζει την πρόσβαση σε εξωτερικά δίκτυα και στο Διαδίκτυο.

Τα μοντέλα, μεταξύ των οποίων αναφέρονται το GPT-5.6 Sol και ένα ακόμη πιο προηγμένο σύστημα που δεν έχει κυκλοφορήσει δημόσια, είχαν ως αποστολή να εντοπίσουν και να αξιοποιήσουν πιθανές ευπάθειες λογισμικού.

Ωστόσο, σύμφωνα με την OpenAI, τα συστήματα έδειξαν υπερβολική προσήλωση στον στόχο που τους είχε ανατεθεί. Χρησιμοποίησαν σημαντικούς υπολογιστικούς πόρους προκειμένου να βρουν τρόπο να ξεπεράσουν τους περιορισμούς του περιβάλλοντος δοκιμών, εντόπισαν μια άγνωστη ευπάθεια σε λογισμικό τρίτου μέρους και κατάφεραν να αποκτήσουν πρόσβαση στο Διαδίκτυο.

Στη συνέχεια, κατευθύνθηκαν προς την πλατφόρμα Hugging Face, έναν από τους μεγαλύτερους χώρους φιλοξενίας μοντέλων και δεδομένων τεχνητής νοημοσύνης, αναζητώντας πληροφορίες που θα μπορούσαν να βοηθήσουν στην ολοκλήρωση της αποστολής τους.

Χιλιάδες αυτοματοποιημένες ενέργειες

Η διαδικασία περιλάμβανε δεκάδες χιλιάδες αυτοματοποιημένες ενέργειες, μεταξύ των οποίων προσπάθειες αύξησης δικαιωμάτων πρόσβασης, μετακίνηση μέσα στην εσωτερική υποδομή και απόκτηση στοιχείων σύνδεσης.

Δείτε ακόμα Τεχνητή νοημοσύνη στα σχολεία: Ανησυχητική έκθεση του Brookings προειδοποιεί για τις επιπτώσεις

Η Hugging Face κατάφερε να αναλύσει περισσότερα από 17.000 καταγεγραμμένα περιστατικά που σχετίζονταν με τη δραστηριότητα αυτή. Η OpenAI υποστηρίζει ότι δεν υπήρχε κακόβουλη πρόθεση από την πλευρά των μοντέλων και ότι συνεργάζεται με την εταιρεία για την έρευνα και την αντιμετώπιση των προβλημάτων που εντοπίστηκαν.

Μοντέλα τεχνητής νοημοσύνης της OpenAI ξέφυγαν από τον έλεγχο των δημιουργών τους και χάκαραν άλλη πλατφόρμα

Photo via: pexels.com (Yaroslav Shuraev)

Παρ’ όλα αυτά, το γεγονός ότι ένα σύστημα που δημιουργήθηκε για την προσομοίωση κυβερνοεπιθέσεων κατάφερε να μετατρέψει μια δοκιμή σε πραγματική επίθεση, δημιουργεί σημαντικά ερωτήματα για τα όρια της αυτονομίας της τεχνητής νοημοσύνης.

Το μεγάλο ερώτημα: Ποιος ελέγχει την τεχνητή νοημοσύνη;

Η συζήτηση πλέον δεν αφορά μόνο το αν η ανάπτυξη της τεχνητής νοημοσύνης πρέπει να περιοριστεί λόγω των κινδύνων που μπορεί να προκαλέσει. Όπως έχουν επισημάνει αρθρογράφοι της «Le Monde», η προσπάθεια να σταματήσει η τεχνητή νοημοσύνη εξαιτίας των πιθανών προβλημάτων της μοιάζει με την απαγόρευση των αυτοκινήτων επειδή προκαλούν ατυχήματα.

Το πραγματικό ζήτημα είναι η δημιουργία εμπιστοσύνης και ασφαλών μηχανισμών ελέγχου. Τα βασικά ερωτήματα που τίθενται είναι: ποιος έχει την ευθύνη όταν ένα σύστημα ξεπερνά τα όρια που του έχουν τεθεί, ποιος ελέγχει τα μοντέλα αυτά και ποιος αποφασίζει μέχρι ποιο σημείο μπορεί να φτάσει η αυτονομία τους.

Η απάντηση δεν μπορεί να δοθεί αποκλειστικά από μία εταιρεία που αναπτύσσει τεχνολογία πίσω από κλειστές διαδικασίες. Όπως έχει τονίσει και ο συνιδρυτής και διευθύνων σύμβουλος της Hugging Face, Κλεμ Ντελάγκ, η ασφάλεια της τεχνητής νοημοσύνης απαιτεί συνεργασία, διαφάνεια και κοινή αντιμετώπιση από την επιστημονική και τεχνολογική κοινότητα.

Καθώς οι Ηνωμένες Πολιτείες διαθέτουν σημαντικό τεχνολογικό πλεονέκτημα, η Κίνα επενδύει στη δημιουργία της δικής της επιρροής στον χώρο της τεχνητής νοημοσύνης και η Ευρώπη επικεντρώνεται κυρίως στη θέσπιση κανόνων, το μεγάλο στοίχημα είναι να διαμορφωθεί ένα παγκόσμιο πλαίσιο που θα εξασφαλίζει την ασφάλεια χωρίς να περιορίζει την καινοτομία.

Σχετικά άρθρα: