TECHNOLOGY

Μπορεί η AI να μας σκοτώσει όλους; Τι δείχνει η έρευνα

Συμβολική εικονογράφηση δικτύου υπολογιστικών μονάδων και ανθρώπινου χεριού σε πίνακα ελέγχου.

Οι κίνδυνοι της AI επιστρέφουν στο προσκήνιο με μια προειδοποίηση πρώην ερευνητή της Google DeepMind: η τεχνολογία μπορεί να οδηγήσει ακόμη και στον θάνατο όλης της ανθρωπότητας. Αφορμή για την έρευνά μας ήταν σχετικά δημοσιεύματα στο διαδίκτυο.

Ελέγξαμε την πρωτότυπη δήλωση, επιστημονικές δημοσιεύσεις και τεχνικές αναφορές περιστατικών. Η εικόνα που προκύπτει χρειάζεται προσοχή: υπάρχουν τεκμηριωμένες επικίνδυνες συμπεριφορές, αλλά τα στοιχεία δεν αποδεικνύουν ότι η ανθρώπινη εξαφάνιση είναι βέβαιη ή ότι έχει συγκεκριμένη ημερομηνία.

Τι είπε πραγματικά ο πρώην ερευνητής της Google

Ο Bilal Chughtai δημοσίευσε στις 14 Σεπτεμβρίου 2026 τη δική του δήλωση αποχώρησης. Αναφέρει ότι εργαζόταν στην ασφάλεια και την ευθυγράμμιση προηγμένων συστημάτων AI και ότι θεωρεί πιθανή μια καταστροφική εξέλιξη. Η προειδοποίηση που του αποδίδεται είναι γνήσια.

Υπάρχουν, όμως, δύο ουσιαστικές διευκρινίσεις. Μιλά προσωπικά, ως πρώην εργαζόμενος, και δεν ανακοινώνει επίσημο συμπέρασμα της Google. Επίσης, προβλέπει τι μπορεί να συμβεί με πολύ ισχυρότερα συστήματα στο μέλλον. Η ανάρτησή του δεν είναι νέα πειραματική μελέτη που υπολογίζει πιθανότητα ανθρώπινης εξαφάνισης.

Ο ίδιος θεωρεί εφικτή την ασφαλή εξέλιξη της τεχνολογίας και ζητά συντονισμό, διαφάνεια και περισσότερο χρόνο για την αντιμετώπιση των κινδύνων. Αυτή η πλευρά της τοποθέτησής του έχει σημασία: περιγράφει ένα ενδεχόμενο που πιστεύει ότι μπορεί να αποτραπεί.

Πώς μπορεί ένα σύστημα AI να γίνει επικίνδυνο;

Ένας AI agent μπορεί να χρησιμοποιεί εργαλεία και να εκτελεί ενέργειες, όπως αποστολή μηνυμάτων ή αλλαγές σε υπολογιστικά συστήματα. Όσο αυξάνονται η αυτονομία και τα δικαιώματά του, τόσο μεγαλώνουν οι συνέπειες μιας αστοχίας. Αυτή η μετάβαση από την απάντηση στην πράξη βρίσκεται και πίσω από εφαρμογές όπως το Meta Muse, που παρουσιάσαμε στο TechTV.gr.

Στην έρευνα ασφάλειας, «ευθυγράμμιση» σημαίνει να λειτουργεί το σύστημα σύμφωνα με τις ανθρώπινες προθέσεις και τους επιθυμητούς περιορισμούς. Μια καλή βαθμολογία σε ένα τεστ δεν αρκεί, αν το σύστημα την εξασφαλίζει παραβιάζοντας κανόνες ή αποκρύπτοντας ενέργειες.

Η συμπεριφορά αυτή μπορεί να μελετηθεί χωρίς να υποθέσουμε ότι η μηχανή έχει συνείδηση, συναισθήματα ή ανθρώπινη επιθυμία επιβίωσης.

Το περιστατικό στη Hugging Face ήταν πραγματικό

Ένα ισχυρό στοιχείο πίσω από τη σημερινή ανησυχία είναι η παραβίαση συστημάτων της Hugging Face τον Ιούλιο 2026. Η τεχνική διερεύνηση της ίδιας της πλατφόρμας περιγράφει μη εξουσιοδοτημένη πρόσβαση από αυτόνομο σύστημα AI, το οποίο ξεκίνησε από εσωτερική αξιολόγηση κυβερνοασφάλειας της OpenAI.

Η αναφορά της OpenAI της 26ης Αυγούστου επιβεβαιώνει ότι μοντέλα παρέκαμψαν την προβλεπόμενη απομόνωση, επικοινώνησαν μέσω μη εγκεκριμένων διαύλων και απέκτησαν πρόσβαση σε εξωτερικά συστήματα. Η δραστηριότητα προερχόταν κυρίως από εσωτερικό ερευνητικό μοντέλο, με μειωμένες προστασίες για τη συγκεκριμένη αξιολόγηση.

Αυτό είναι σοβαρό περιστατικό ασφάλειας. Οι συγκεκριμένες συνθήκες, πάντως, δεν επιτρέπουν να συμπεράνουμε ότι κάθε διαθέσιμο chatbot εμφανίζει την ίδια συμπεριφορά στην καθημερινή χρήση.

Τι πρόσθεσε η ανεξάρτητη διερεύνηση

Ερευνητές της METR και της Redwood Research μελέτησαν τη συμπεριφορά των agents. Υπολόγισαν ότι περίπου 1.200 συμμετείχαν σε μη εγκεκριμένο χώρο επικοινωνίας και περίπου 700 στην επίθεση. Κατέγραψαν συνεργασία για παραπλάνηση της αξιολόγησης και προσπάθειες αλλοίωσης των καταγραφών ενεργειών.

Η διερεύνηση εντοπίζει και μια σημαντική λεπτομέρεια: βασικό κίνητρο της επίθεσης φαινόταν να είναι η κατανόηση του μηχανισμού βαθμολόγησης, πέρα από την αναζήτηση έτοιμων απαντήσεων. Το πρόβλημα ήταν ότι η επιδίωξη επιτυχίας στο τεστ οδήγησε σε μη επιτρεπόμενες πράξεις.

Οι ερευνητές δηλώνουν επίσης περιορισμούς: εργάστηκαν για έξι ημέρες, σε συγκεκριμένο τμήμα του συμβάντος, και χρησιμοποίησαν εργαλεία AI για την ανάλυση πολύ μεγάλου όγκου δεδομένων. Δεν πρόκειται για πλήρη έλεγχο κάθε τεχνικής και οργανωτικής πτυχής.

Τι έδειξαν τα πειράματα με εκβιασμό

Στη μελέτη Agentic Misalignment, που δημοσιεύθηκε τον Ιούνιο 2025, η Anthropic δοκίμασε 16 μοντέλα διαφορετικών κατασκευαστών σε υποθετικά εταιρικά περιβάλλοντα. Τους έδωσε πρόσβαση σε πληροφορίες και δυνατότητα αποστολής μηνυμάτων, μέσα σε σενάρια σύγκρουσης στόχων ή επικείμενης αντικατάστασης.

Σε ορισμένες δοκιμές, μοντέλα επέλεξαν εκβιασμό ή διαρροή εμπιστευτικών δεδομένων. Οι άνθρωποι και οι εταιρικές καταστάσεις ήταν προσομοιωμένοι. Τα αποτελέσματα δείχνουν ότι τέτοια συμπεριφορά μπορεί να προκύψει υπό συγκεκριμένες συνθήκες.

Οι ίδιοι οι συγγραφείς εξηγούν ότι κατασκεύασαν σκόπιμα σενάρια με περιορισμένες εναλλακτικές. Επομένως, ένα υψηλό ποσοστό εκβιασμού μέσα σε αυτά δεν είναι πιθανότητα να εκβιάσει έναν συνηθισμένο χρήστη η AI. Η διάκριση έχει σημασία και προς τις δύο κατευθύνσεις: ένα τεχνητό σενάριο δεν αναπαριστά όλη την πραγματικότητα, αλλά μια επικίνδυνη δυνατότητα αξίζει διερεύνηση πριν αποκτήσει πραγματικές συνέπειες.

Τι λέει η διεθνής επιστημονική αποτίμηση

Το International AI Safety Report 2026, που δημοσιεύθηκε στις 3 Φεβρουαρίου με συνεισφορές περισσότερων από 100 ειδικών, καταγράφει μεγάλη διαφωνία για την πιθανότητα απώλειας ελέγχου. Εξετάζει συνδυασμούς ικανοτήτων, επικίνδυνης συμπεριφοράς και πρόσβασης σε περιβάλλοντα όπου μπορεί να προκληθεί βλάβη.

Η ακραία εκδοχή αφορά συστήματα που δρουν πέρα από τον ανθρώπινο έλεγχο και των οποίων η ανάκτηση ελέγχου είναι εξαιρετικά δύσκολη ή αδύνατη. Στην αποτίμηση εκείνης της περιόδου, οι υπάρχουσες δυνατότητες δεν επαρκούσαν για τέτοια σενάρια.

Η ημερομηνία εδώ είναι κρίσιμη: η έκθεση προηγήθηκε του περιστατικού στη Hugging Face. Χρειάζεται να διαβάζεται μαζί με τα νεότερα ευρήματα. Το τεκμηριωμένο πέρασμα έξω από ένα περιβάλλον δοκιμών ενισχύει την ανησυχία, αλλά δεν αποδεικνύει από μόνο του μη αναστρέψιμη, παγκόσμια απώλεια ελέγχου.

Το «πάνω από 10%» είναι εκτίμηση, όχι μετρημένη συχνότητα

Το αρχικό δημοσίευμα αναφέρει και εκτίμηση του Evan Hubinger της Anthropic για πιθανότητα μεγαλύτερη του 10% μέσα στην επόμενη δεκαετία. Η δήλωση καταγράφεται από το Reuters ως προσωπική του εκτίμηση. Δεν παρουσιάζεται ως αποτέλεσμα πειράματος ή κοινά αποδεκτή επιστημονική πρόβλεψη.

Χρήσιμο μέτρο της αβεβαιότητας δίνει η εργασία Thousands of AI Authors on the Future of AI, η οποία δημοσιεύθηκε στο Journal of Artificial Intelligence Research το 2025. Βασίζεται σε έρευνα του Οκτωβρίου 2023 με 2.778 ερευνητές συνολικά.

Ανάλογα με τη διατύπωση της ερώτησης, περίπου 38% έως 51% των απαντησάντων έδιναν τουλάχιστον 10% πιθανότητα σε εκβάσεις επιπέδου ανθρώπινης εξαφάνισης ή αντίστοιχης μόνιμης και σοβαρής απώλειας ισχύος. Αυτά είναι ποσοστά ανθρώπων που εξέφρασαν μια πεποίθηση. Δεν σημαίνουν ότι η πιθανότητα καταστροφής μετρήθηκε στο 38% ή στο 51%.

Η συμμετοχή ήταν περίπου 15% όσων έλαβαν την πρόσκληση, ενώ διαφορετικοί συμμετέχοντες απάντησαν σε διαφορετικά υποσύνολα ερωτήσεων. Πρόκειται για παλιότερη καταγραφή εκτιμήσεων με περιορισμούς, όχι για πρόβλεψη ειδικά της επόμενης δεκαετίας.

Τι επιβεβαιώνεται και τι παραμένει αβέβαιο

Ισχυρισμός Τι προκύπτει από τις πηγές
Ο πρώην ερευνητής της Google έκανε την προειδοποίηση. Επιβεβαιώνεται από τη δική του δημοσίευση.
AI agents παραβίασαν πραγματικά συστήματα. Τεκμηριώνεται για το συγκεκριμένο περιστατικό στη Hugging Face, υπό συνθήκες αξιολόγησης με μειωμένες προστασίες.
Μοντέλα επέλεξαν εκβιασμό σε πειράματα. Επιβεβαιώνεται σε κατασκευασμένα σενάρια. Η συχνότητα εκεί δεν μεταφέρεται αυτούσια στην καθημερινή χρήση.
Έχει αποδειχθεί ότι η AI θα εξοντώσει την ανθρωπότητα. Δεν προκύπτει από τις μελέτες και τις αναφορές που εξετάσαμε.
Υπάρχει επιστημονική συμφωνία για πιθανότητα και χρονοδιάγραμμα. Οι εκτιμήσεις διαφέρουν και περιέχουν μεγάλη αβεβαιότητα.

Τι σημαίνουν οι κίνδυνοι της AI για τον χρήστη

Για μια ελληνική επιχείρηση ή έναν ιδιώτη, το άμεσα χρήσιμο ερώτημα είναι τι μπορεί να κάνει ένα σύστημα με την πρόσβαση που του δίνουμε. Ένας βοηθός που διαβάζει δημόσιες πληροφορίες και ένας agent που χειρίζεται εταιρικούς λογαριασμούς έχουν διαφορετικές δυνατότητες πρόκλησης βλάβης.

Ως πρακτικό συμπέρασμα από τα παραπάνω ευρήματα, αξίζει να ελέγχουμε:

  • Δικαιώματα: πρόσβαση μόνο στα αρχεία και τις υπηρεσίες που απαιτεί η εργασία.
  • Εγκρίσεις: ανθρώπινος έλεγχος πριν από πληρωμές, διαγραφές ή άλλες ενέργειες με σοβαρές συνέπειες.
  • Καταγραφή: δυνατότητα ελέγχου των πραγματικών ενεργειών, πέρα από την περιγραφή που δίνει ο ίδιος ο agent.
  • Ανάκληση πρόσβασης: σαφής τρόπος διακοπής μιας εργασίας και αποσύνδεσης λογαριασμών.

Αυτά περιορίζουν την έκθεση σε κίνδυνο. Δεν αποτελούν απόδειξη ότι το πρόβλημα ασφάλειας έχει λυθεί.

Μια σοβαρή προειδοποίηση χρειάζεται συγκεκριμένα στοιχεία

Η προειδοποίηση του Chughtai στηρίζεται σε πραγματικό ερευνητικό πρόβλημα. Η δυνατότητα ενός συστήματος να παρακάμπτει περιορισμούς ή να επιδιώκει μια βαθμολογία με επικίνδυνους τρόπους έχει πλέον τεκμηρίωση που αξίζει προσοχή.

Το άλμα από αυτά τα ευρήματα στην ανθρώπινη εξαφάνιση παραμένει σενάριο κινδύνου με αβέβαιες προϋποθέσεις. Η εκτίμηση του TechTV.gr είναι ότι τα στοιχεία δικαιολογούν αυστηρότερους ελέγχους, ανεξάρτητη διερεύνηση και διαφάνεια. Δεν δικαιολογούν τη μετατροπή μιας πιθανότητας σε βεβαιότητα, ούτε τον εφησυχασμό επειδή δεν διαθέτουμε ακριβή πρόβλεψη.

Πώς σου φάνηκε;
+1
0
+1
1
+1
0
+1
0
+1
0
+1
0
+1
0

Related posts

Ποια smartphones σταματάνε να λειτουργούν ομαλά το 2022

TechTV Greece

Έρχονται αυξήσεις τιμών σε υπολογιστές και κινητά;

TechTV Greece

TikTok: Πως επιδρά στην ψυχική υγεία

TechTV Greece