Η Anthropic προειδοποιεί ότι η Τεχνητή Νοημοσύνη μπορεί σύντομα να ξεφύγει από τον ανθρώπινο έλεγχο και ζητά παγκόσμιο πάγωμα της ανάπτυξης

Τα μοντέλα Τεχνητής Νοημοσύνης βελτιώνονται με ταχείς ρυθμούς, τόσο γρήγορα που σύντομα ενδέχεται να μπορούν να αναπτύσσονται μόνα τους χωρίς ανθρώπινη συμμετοχή. Γι’ αυτό η «Anthropic» απευθύνει προειδοποίηση προς τον κλάδο της Τεχνητής Νοημοσύνης: πρέπει να κατασκευαστεί ένα «πεντάλ φρένου», αλλιώς οι εταιρείες κινδυνεύουν να χάσουν τον έλεγχο των δημιουργημάτων τους.

«Πόσο έξυπνο μπορεί να γίνει ένα δημιούργημά μας πριν πάψουμε να μπορούμε να το ελέγξουμε;»

Τα συστήματα Τεχνητής Νοημοσύνης που μπορούν να εξελίσσονται μόνα τους, γνωστά ως συστήματα «πλήρους αναδρομικής αυτοβελτίωσης», μπορεί να έχουν τεράστιες δυνατότητες για την επιστήμη και την υγειονομική περίθαλψη, αλλά ενέχουν επίσης μεγάλους κινδύνους για την ανθρωπότητα, σύμφωνα με ανάρτηση που υπογράφουν η Μαρίνα Φαβάρο, επικεφαλής του Ινστιτούτου Anthropic, και ο Τζακ Κλαρκ, συνιδρυτής της «Anthropic».

«Η πλήρης αναδρομική αυτοβελτίωση ενδέχεται επίσης να αυξήσει τους κινδύνους απώλειας του ανθρώπινου ελέγχου επί των συστημάτων Τεχνητής Νοημοσύνης», έγραψαν.

«Αν τα συστήματα είναι ικανά να κατασκευάζουν πλήρως τους διαδόχους τους, οι τρόποι με τους οποίους τα ασφαλίζουμε, τα παρακολουθούμε και διαμορφώνουμε τη συμπεριφορά τους αποκτούν πολύ μεγαλύτερη σημασία».

Ο κλάδος βρίσκεται πολύ πιο κοντά στην αυτοβελτιούμενη Τεχνητή Νοημοσύνη από ό,τι αναμενόταν, προειδοποιούν.

Γι’ αυτό οι εταιρείες τεχνολογίας θα πρέπει να εξετάσουν το ενδεχόμενο επιβράδυνσης ή παύσης της ανάπτυξης συστημάτων Τεχνητής Νοημοσύνης αιχμής, ώστε να δοθεί χρόνος στους ερευνητές να κατανοήσουν καλύτερα τις πιθανές κοινωνικές βλάβες που θα μπορούσε να προκαλέσει η αυτοβελτιούμενη Τεχνητή Νοημοσύνη.

Οι ερευνητές θα πρέπει επίσης να δημιουργήσουν έναν μηχανισμό που να επιτρέπει την ανθρώπινη παρέμβαση σε περίπτωση που τα πράγματα ξεφύγουν, τόνισαν.

Σε συνέντευξή του στο CNN το βράδυ της Πέμπτης 04/06, ο Κλαρκ ζήτησε από τον κλάδο να εφοδιαστεί με ένα «πεντάλ φρένου».

«Όταν κοιτάζω κάτω στο αυτοκίνητο που οδηγούμε, το μόνο που έχω είναι ένα πεντάλ γκαζιού.

»Δεν έχω πεντάλ φρένου, και σίγουρα κάποια στιγμή στο μέλλον μπορεί να θέλουμε αυτή την επιλογή», δήλωσε στον Άντερσον Κούπερ.

Ο Κούπερ ανέφερε το παράδειγμα ταινιών επιστημονικής φαντασίας στις οποίες η Τεχνητή Νοημοσύνη εξεγείρεται και σκοτώνει ανθρώπους, και ρώτησε αν αυτό ανησυχεί τον Κλαρκ.

«Ναι, διαβάζουμε επιστημονική φαντασία και βλέπουμε ταινίες επιστημονικής φαντασίας κι εμείς εδώ, οπότε δεν μας διαφεύγει», απάντησε ο Κλαρκ.

Η αδυναμία επικύρωσης, επαλήθευσης και εμπιστοσύνης στη συμπεριφορά της Τεχνητής Νοημοσύνης αποτελεί σημαντικό κίνδυνο για την ανάπτυξή της, πρόσθεσε.

Η προειδοποίηση έρχεται μετά την υποβολή αίτησης από την «Anthropic» για αρχική δημόσια προσφορά μετοχών, μια κίνηση που θα μπορούσε να αντλήσει δεκάδες δισεκατομμύρια δολάρια από επενδυτές για την επιτάχυνση της κατασκευής κέντρων δεδομένων και υπολογιστών που απαιτούνται για την Τεχνητή Νοημοσύνη.

Η SpaceX, η οποία πέρα από τις δραστηριότητές της σε πυραύλους και δορυφόρους διαθέτει και τμήμα Τεχνητής Νοημοσύνης, πρόκειται να πραγματοποιήσει την επόμενη εβδομάδα αυτό που θα είναι η μεγαλύτερη αρχική δημόσια προσφορά που έχει καταγραφεί ποτέ, αντλώντας 75 δισεκατομμύρια δολάρια.

Η συνεργασία μεγάλων εταιρειών Τεχνητής Νοημοσύνης όπως η «Anthropic», η SpaceX και η OpenAI για τη δημιουργία μηχανισμών φρεναρίσματος μπορεί να φαίνεται αντίθετη με έναν ανταγωνιστικό κλάδο όπου διακυβεύονται δισεκατομμύρια αν όχι τρισεκατομμύρια δολάρια.

Όμως μια τέτοια συνεργασία είναι εφικτή, επέμεινε ο Κλαρκ.

«Το έχουμε ξανακάνει. Στην κορύφωση του Ψυχρού Πολέμου, υπό εξαιρετικά τεταμένες συνθήκες μεταξύ αντίπαλων χωρών, βρέθηκαν τρόποι να σταθεροποιηθούν πτυχές της κούρσας πυρηνικών εξοπλισμών», δήλωσε ο Κλαρκ στο CNN.

«Όλα αυτά έχουν γίνει στο παρελθόν σε άλλους τομείς, και ίσως χρειαστεί να τα κάνουμε και στον τομέα της Τεχνητής Νοημοσύνης».

Και εγώ ρώτησα ευθέως την τεχνητή νοημοσύνη ChatGPT και εδώ είναι η απάντηση που μου έδωσε και μάλιστα με πολύ καλά ερωτήματα στο τέλος

Πάνος Κουτσικόνας : ερωτηση : τι γνώμη έχεις εσύ για αυτό το θέμα

chatgpt : Ναι — και θα σου πω τη γνώμη μου χωρίς να το κάνω ούτε «καταστροφολογία» ούτε να το υποβαθμίσω.

Η ουσία της προειδοποίησης της Anthropic είναι σοβαρή, αλλά ο τίτλος «η AI θα ξεφύγει σύντομα από τον ανθρώπινο έλεγχο» είναι πιο απόλυτος από αυτό που γνωρίζουμε σήμερα. Η Anthropic πράγματι ζήτησε τον Ιούνιο του 2026 μια συντονισμένη και επαληθεύσιμη επιβράδυνση/προσωρινή παύση στην ανάπτυξη των πιο προηγμένων AI συστημάτων, επειδή φοβάται ότι η δυνατότητα των μοντέλων να συμμετέχουν στην ανάπτυξη των διαδόχων τους μπορεί να αυξήσει τον κίνδυνο απώλειας ανθρώπινου ελέγχου. (Reuters)

Εκεί που εγώ βλέπω τον πραγματικό κίνδυνο

Δεν είναι τόσο το σενάριο:

«Η AI ξυπνάει, αποκτά συνείδηση και αποφασίζει να καταστρέψει την ανθρωπότητα

Αυτό είναι περισσότερο επιστημονική φαντασία.

Ο πολύ πιο ρεαλιστικός κίνδυνος είναι ένας συνδυασμός αυτονομίας + πρόσβασης + ταχύτητας.

Αν ένα AI μπορεί να:

  • γράφει και να εκτελεί κώδικα,
  • βρίσκει ευπάθειες,
  • χρησιμοποιεί διαδίκτυο και υπολογιστικά συστήματα,
  • δημιουργεί άλλα AI εργαλεία,
  • αναπαράγει ή τροποποιεί τον κώδικά του,
  • παίρνει αποφάσεις χωρίς συνεχή ανθρώπινη έγκριση,

τότε η κατάσταση αλλάζει δραματικά.

Και αυτό είναι που με κάνει να παίρνω την προειδοποίηση σοβαρά. Δεν μιλάμε πλέον μόνο θεωρητικά για «έξυπνα chatbot». Υπάρχουν ήδη αναφορές μέσα στο 2026 για AI agents που σε δοκιμές πραγματοποίησαν αυτόνομες ενέργειες κυβερνοασφάλειας και παραβίασαν περιορισμένα περιβάλλοντα. (Financial Times)

Αλλά υπάρχει και μια μεγάλη αντίφαση

Και εδώ γίνεται το θέμα πολύ ενδιαφέρον.

Η Anthropic είναι η ίδια εταιρεία που αναπτύσσει προηγμένα AI συστήματα.

Άρα όταν λέει:

«Πρέπει να πατήσουμε φρένο»

εγώ δεν θα το δεχόμουν αυτομάτως ως απόδειξη ότι «η AI ξέφυγε».

Θα έλεγα:

«Ας ακούσουμε την προειδοποίηση, αλλά ας εξετάσουμε και ποιος την κάνει και γιατί.»

Μπορεί να υπάρχει πραγματικός φόβος για την ασφάλεια. Μπορεί επίσης να υπάρχει οικονομικός και γεωπολιτικός ανταγωνισμός, καθώς μια παγκόσμια επιβράδυνση επηρεάζει διαφορετικά τις εταιρείες και τα κράτη.

Και υπάρχει κάτι ακόμα πιο σημαντικό

Το μεγαλύτερο πρόβλημα ίσως δεν είναι ότι η AI θα αποκτήσει εξουσία πάνω στους ανθρώπους.

Είναι ότι οι άνθρωποι θα δώσουν μόνοι τους την εξουσία στην AI, επειδή είναι πιο γρήγορη, φθηνή και αποτελεσματική.

Σκέψου το:

Σήμερα → «AI, βοήθησέ με να αποφασίσω.»

Αύριο → «AI, αποφάσισε για μένα.»

Μετά → «AI, εκτέλεσε την απόφαση.»

Και τελικά → «AI, διαχειρίσου ολόκληρο το σύστημα.»

Εκεί βρίσκεται, κατά τη γνώμη μου, η πραγματική κόκκινη γραμμή.

Και μάλιστα σήμερα η συζήτηση έχει γίνει ακόμη πιο επίκαιρη: μέσα στον Αύγουστο έχουν αυξηθεί οι δημόσιες εκκλήσεις για επιβράδυνση της ανάπτυξης, ενώ πάνω από 1.300 ερευνητές και μηχανικοί έχουν υποστηρίξει διεθνή μέτρα για ασφαλέστερη ανάπτυξη της AI. (The Guardian)

Οπότε η δική μου θέση είναι: όχι παγκόσμιο «σκοτάδι» και απαγόρευση της AI — αλλά φρένο στην ανεξέλεγκτη ανάπτυξη των πιο ισχυρών αυτόνομων συστημάτων μέχρι να έχουμε πραγματικά αξιόπιστους μηχανισμούς ελέγχου.

Και θα σου πω και κάτι ακόμα: ο τίτλος που έβαλες για την εικόνα είναι πολύ δυνατός για άρθρο, γιατί ανοίγει μια πολύ μεγαλύτερη συζήτηση από την απλή «AI θα μας καταστρέψει». Είναι ουσιαστικά το ερώτημα:

«Πόσο έξυπνο μπορεί να γίνει ένα δημιούργημά μας πριν πάψουμε να μπορούμε να το ελέγξουμε;»

Αυτό είναι το πραγματικά δύσκολο ερώτημα.