«Παίζουν με τις ζωές μας». Με αυτή την καταγγελία, ο ερευνητής Τζέικομπ Κόξον (Jacob Coxon) ανακοίνωσε την παραίτησή του από την Anthropic, στρέφοντας τα πυρά του τόσο εναντίον της δημιουργού του Claude όσο και της προηγούμενης εργοδότριάς του, OpenAI. Υποστηρίζει ότι η μεταξύ τους κούρσα οδηγεί προς συστήματα τεχνητής νοημοσύνης που θα μπορούν να βελτιώνουν τον εαυτό τους, χωρίς επαρκείς εγγυήσεις ότι θα παραμείνουν υπό ανθρώπινο έλεγχο.
Ο Κόξον ανέφερε στην ανάρτηση με την οποία γνωστοποίησε την αποχώρησή του ότι τα τελευταία τρία χρόνια εργάστηκε στην προεκπαίδευση μοντέλων στις δύο εταιρείες. Πρόκειται για το στάδιο κατά το οποίο ένα μοντέλο μαθαίνει από μεγάλους όγκους δεδομένων, πριν προσαρμοστεί για πιο συγκεκριμένες χρήσεις.
Την παραίτηση κατέγραψε ο Άμριθ Ραμκουμάρ στη Wall Street Journal, μεταφέροντας την ανησυχία του ερευνητή για μια τεχνολογική κούρσα που θα μπορούσε να ξεφύγει από τον έλεγχο των δημιουργών της.
Η προειδοποίηση για το τέλος της δεκαετίας
Σε επόμενη ανάρτησή του, ο Κόξον υποστήριξε ότι άνθρωποι που κατασκευάζουν προηγμένα συστήματα AI θεωρούν πραγματικό το ενδεχόμενο καταστροφικών συνεπειών για την ανθρωπότητα πριν από το τέλος της δεκαετίας. Απέδωσε επίσης σε στελέχη και ερευνητές μεγαλύτερη ιδιωτική ανησυχία από εκείνη που εκφράζουν δημοσίως.
Αυτή είναι η εκτίμηση και η καταγγελία του ίδιου. Η παραίτηση δεν αποδεικνύει ότι ένα ανεξέλεγκτο σύστημα έχει ήδη δημιουργηθεί ούτε ότι υπάρχει συμφωνημένη επιστημονική πρόβλεψη καταστροφής. Αναδεικνύει, όμως, μια διαφωνία μέσα στον κλάδο για το πόσο ρίσκο είναι αποδεκτό και ποιος δικαιούται να το αναλάβει.
Όταν η AI κατασκευάζει την επόμενη AI
Το επίμαχο σενάριο αφορά τη λεγόμενη αναδρομική αυτοβελτίωση: ένα σύστημα αποκτά την ικανότητα να σχεδιάζει και να αναπτύσσει τον διάδοχό του, ο οποίος με τη σειρά του επιταχύνει την επόμενη αναβάθμιση. Η ανησυχία είναι ότι ο ρυθμός εξέλιξης μπορεί να ξεπεράσει την ικανότητα των ανθρώπων να κατανοούν και να ελέγχουν κάθε βήμα.
Η ίδια η Anthropic, στο κείμενο «When AI builds itself», αναγνωρίζει ότι η AI επιταχύνει ήδη την ανάπτυξη νέων μοντέλων. Διευκρινίζει, ωστόσο, ότι η πλήρης αυτοβελτίωση δεν έχει επιτευχθεί και δεν είναι αναπόφευκτη. Παράλληλα, τάσσεται υπέρ της δυνατότητας συντονισμένης επιβράδυνσης, με επαλήθευση της συμμετοχής των ανταγωνιστών.
Ο φόβος είναι υπαρκτός, η συναίνεση περιορισμένη
Η συζήτηση αποτυπώνεται και σε ερευνητική εργασία των Σέβεριν Φιλντ, Ρέιμοντ Ντάγκλας και Ντέιβιντ Κρούγκερ, η οποία βασίστηκε σε συνεντεύξεις με 25 ερευνητές από εργαστήρια και πανεπιστήμια τον Αύγουστο και τον Σεπτέμβριο του 2025. Οι 20 χαρακτήρισαν την αυτοματοποίηση της έρευνας AI έναν από τους σοβαρότερους και πιο επείγοντες κινδύνους. Διαφωνούσαν, όμως, για τον χρονικό ορίζοντα και τους κατάλληλους μηχανισμούς εποπτείας.
Το μικρό, επιλεγμένο δείγμα καταγράφει απόψεις ειδικών. Δεν αποτελεί δημοσκόπηση ολόκληρης της επιστημονικής κοινότητας ούτε μέτρηση πιθανότητας ενός καταστροφικού γεγονότος.
Ποιος μπορεί να επιβάλει όρια στην κούρσα
Η αποχώρηση του Κόξον μεταφέρει τη διαμάχη από το εργαστήριο στην πολιτική. Αν μια εταιρεία θεωρεί ότι η επιβράδυνση θα παραδώσει το προβάδισμα σε έναν λιγότερο προσεκτικό ανταγωνιστή, η αναγνώριση του κινδύνου δεν αρκεί για να αλλάξει τη συμπεριφορά της. Το ίδιο δίλημμα μπορεί να εμφανιστεί ανάμεσα σε κράτη που αντιμετωπίζουν την AI ως πηγή οικονομικής και στρατηγικής ισχύος.
Η Anthropic δημοσιεύει πολιτική διαχείρισης κινδύνων και σχετικές εκθέσεις. Το ζητούμενο για τη δημόσια εποπτεία είναι κατά πόσο τέτοιες δεσμεύσεις επιτρέπουν ανεξάρτητο έλεγχο και ουσιαστική παρέμβαση. Σύμφωνα με το Γαλλικό Πρακτορείο, οι δύο εταιρείες δεν είχαν απαντήσει άμεσα στο αίτημά του για σχόλιο κατά τη δημοσίευση του ρεπορτάζ του.
Η παραίτηση θέτει ένα ερώτημα που ξεπερνά την Anthropic: μπορούν οι εταιρείες που ανταγωνίζονται για την ισχυρότερη AI να είναι και οι τελικοί κριτές του αποδεκτού κινδύνου; Η απάντηση θα κριθεί από τους κανόνες πρόσβασης, τις δυνατότητες ελέγχου και την εξουσία παρέμβασης πριν εμφανιστεί μια κρίση.
Strategist Ai · AI Takeaways
- Ο Jacob Coxon ανακοίνωσε την παραίτησή του από την Anthropic, επικρίνοντας και την OpenAI για τον ρυθμό ανάπτυξης της AI.
- Η προειδοποίησή του αφορά μελλοντικά συστήματα που θα αναπτύσσουν τους διαδόχους τους. Δεν αποτελεί επιβεβαιωμένη πρόβλεψη καταστροφής.
- Η διαφωνία αφορά τόσο την τεχνική ασφάλεια όσο και το ποιος έχει την εξουσία να επιβάλει όρια στον ανταγωνισμό.