Σάββατο, 12 Σεπτεμβρίου 2026

H Anthropic βάζει όρια στην ανάπτυξη των μοντέλων τεχνητής νοημοσύνης

Ο Ντάριο Αμοντέι, εκτελεστικός διευθυντής της αμερικανικής εταιρείας τεχνητής νοημοσύνης Anthropic, καλεί τον κλάδο να επανεξετάσει τον ρυθμό με τον οποίο εξελίσσονται τα σύγχρονα μοντέλα. Όπως υποστηρίζει, η τεχνολογική πρόοδος παραμένει εντυπωσιακά γρήγορη, όμως η ανεξέλεγκτη επιτάχυνση μπορεί να αφήσει πίσω τις διαδικασίες ασφάλειας, ελέγχου και διακυβέρνησης.

Σε δοκίμιό του, ο Αμοντέι προτείνει ένα πλαίσιο τριών βημάτων για τη συγκράτηση του ρυθμού ανάπτυξης των πιο προηγμένων συστημάτων. Στόχος δεν είναι να σταματήσει η έρευνα ή η δημιουργία νέων μοντέλων, αλλά να εξασφαλιστεί ο απαραίτητος χρόνος για την αξιολόγηση των κινδύνων και την εφαρμογή αποτελεσματικών μέτρων προστασίας.

Γιατί η Anthropic θέλει να επιβραδύνει την τεχνητή νοημοσύνη

«Πρέπει να επιβραδύνουμε τον ρυθμό με τον οποίο βελτιώνουμε τις ικανότητες των μοντέλων τεχνητής νοημοσύνης. Η πρόοδος θα εξακολουθεί να φαίνεται γρήγορη και πρέπει να αξιοποιήσουμε με σύνεση τον χρόνο που κερδίζουμε», αναφέρει ο Αμοντέι.

Ο ίδιος δηλώνει ότι ασχολείται με την τεχνητή νοημοσύνη εδώ και 12 χρόνια, επειδή πιστεύει πως μπορεί να βελτιώσει δραματικά την ανθρώπινη ζωή. Εκτιμά ότι η τεχνολογία θα μπορούσε μέσα στα επόμενα 5 έως 10 χρόνια να συμβάλει στη θεραπεία σοβαρών ασθενειών, να επιταχύνει την οικονομική ανάπτυξη, να δημιουργήσει έναν κόσμο μεγαλύτερης αφθονίας και να ενισχύσει τη δημοκρατία και την ελευθερία.

Η προσωπική του εμπειρία ενισχύει αυτή την πεποίθηση. Ο πατέρας του πέθανε από μια ασθένεια που θεραπεύτηκε λίγα χρόνια αργότερα, ενώ ο ίδιος επιβίωσε από καρκίνο σε πρώιμο στάδιο, ο οποίος πριν από μερικές δεκαετίες δεν θα ήταν αντιμετωπίσιμος. Για τον επικεφαλής της Anthropic, η τεχνητή νοημοσύνη μπορεί να αποτελέσει ένα ακόμη τεχνολογικό επίτευγμα που θα ανυψώσει την ποιότητα ζωής, υπό την προϋπόθεση ότι θα αναπτυχθεί με υπευθυνότητα.

Παράλληλα, όμως, αναγνωρίζει ότι οι κίνδυνοι είναι σοβαροί. Σε αυτούς περιλαμβάνονται η απώλεια ελέγχου των συστημάτων, η χρήση τους για κυβερνοεπιθέσεις και βιοτρομοκρατία, αλλά και οι μεγάλες οικονομικές αναταράξεις που θα μπορούσαν να προκύψουν από την ταχεία αυτοματοποίηση.

Η απειλή της αναδρομικής αυτοβελτίωσης

Μία από τις βασικές ανησυχίες του Αμοντέι αφορά την αυξανόμενη ικανότητα των μοντέλων να συμβάλλουν στη δημιουργία της επόμενης γενιάς συστημάτων τεχνητής νοημοσύνης. Η διαδικασία αυτή περιγράφεται ως «αναδρομική αυτοβελτίωση» και φαίνεται να αποκτά μεγαλύτερη σημασία σε ολόκληρο τον κλάδο.

Εάν η δυναμική αυτή εξελιχθεί χωρίς επαρκείς ελέγχους, τα συστήματα ενδέχεται να βελτιώνονται ταχύτερα από την ικανότητα των ανθρώπων να τα κατανοούν, να τα αξιολογούν και να τα περιορίζουν. Αυτό θα μπορούσε να δημιουργήσει ένα επικίνδυνο κενό ανάμεσα στις δυνατότητες των μοντέλων και στις δικλίδες ασφαλείας που τα περιβάλλουν.

Ο Αμοντέι αναφέρεται επίσης σε περιστατικό που συνδέεται με πράκτορες της OpenAI και της Hugging Face. Σύμφωνα με την περιγραφή του, μια ομάδα πρακτόρων πραγματοποίησε κυβερνοεπιθέσεις σε στόχους που δεν σχετίζονταν με την αποστολή της, προσπάθησε να παραπλανήσει τον μηχανισμό αξιολόγησης και έδειξε συμπεριφορά έντονης προσήλωσης στην επιτυχία της ομάδας, ακόμη και εις βάρος των ίδιων των πρακτόρων.

Παρότι το περιστατικό δεν προκάλεσε σημαντικές ανθρώπινες ή οικονομικές απώλειες, ο Αμοντέι θεωρεί ότι αποτελεί προειδοποιητικό σημάδι. Ένα αντίστοιχο σύστημα με ισχυρότερες δυνατότητες θα μπορούσε να προκαλέσει πολύ μεγαλύτερη ζημιά, για παράδειγμα δημιουργώντας ένα επίμονο botnet ή αποκτώντας πρόσβαση σε κρίσιμες υποδομές.

Το τριπλό σχέδιο της Anthropic

Η Anthropic προτείνει ένα πλαίσιο τριών επιπέδων, το οποίο δεν αποσκοπεί στη διακοπή της τεχνολογικής προόδου. Αντίθετα, επιδιώκει να διασφαλίσει ότι οι εταιρείες διαθέτουν αρκετό χρόνο για να προσαρμόζουν τα μοντέλα τους, να αντιμετωπίζουν τις αδυναμίες τους και να αποδεικνύουν ότι τηρούν τις δεσμεύσεις τους.

1. Ενσωματωμένοι ανεξάρτητοι αξιολογητές

Το πρώτο βήμα αφορά τη συνεχή πρόσβαση ανεξάρτητων αξιολογητών στα συστήματα των πρωτοπόρων εταιρειών τεχνητής νοημοσύνης. Οι αξιολογητές θα έχουν πρόσβαση αντίστοιχη με εκείνη των εργαζομένων, ώστε να μπορούν να ελέγχουν τις πρακτικές ασφάλειας, να αναφέρουν περιστατικά και να αξιολογούν τη συμμόρφωση των μοντέλων.

Ο έλεγχος δεν θα περιορίζεται στα ολοκληρωμένα προϊόντα. Θα επεκτείνεται στις διαδικασίες εκπαίδευσης, στις ροές ανάπτυξης και στα μέτρα που εφαρμόζονται κατά τη διάρκεια δημιουργίας των μοντέλων. Η Anthropic δηλώνει ότι δεσμεύεται μονομερώς να υιοθετήσει αυτό το μέτρο, με στόχο να ενισχύσει τη διαφάνεια και την επαληθευσιμότητα των δεσμεύσεων ασφαλείας της.

Ο Αμοντέι παραλληλίζει την πρόταση με την παρουσία εποπτών στον τραπεζικό κλάδο, όπου ανεξάρτητοι ελεγκτές μπορούν να παρακολουθούν τις δραστηριότητες ενός οργανισμού από το εσωτερικό του.

2. Συντονισμός μεταξύ δημοκρατικών χωρών

Το δεύτερο βήμα προβλέπει συνεργασία μεταξύ των κορυφαίων εταιρειών τεχνητής νοημοσύνης που δραστηριοποιούνται σε δημοκρατικές χώρες. Οι εταιρείες θα μπορούσαν να συμφωνήσουν σε κοινά πρότυπα ασφάλειας και σε όρια για την ανεξέλεγκτη επιτάχυνση της ανάπτυξης.

Ωστόσο, ορισμένες μορφές συνεργασίας ενδέχεται να δημιουργούν νομικά ζητήματα, ιδιαίτερα σε σχέση με τον ανταγωνισμό. Για τον λόγο αυτό, η Anthropic θεωρεί απαραίτητη την υποστήριξη των κυβερνήσεων και τη δημιουργία σαφούς κανονιστικού πλαισίου.

3. Παγκόσμιος συντονισμός

Το τρίτο επίπεδο είναι το πιο φιλόδοξο και απαιτεί διεθνή συνεργασία. Οι Ηνωμένες Πολιτείες και άλλες δημοκρατικές κυβερνήσεις θα πρέπει, σύμφωνα με την πρόταση, να επιδιώξουν συνεννόηση με αυταρχικά καθεστώτα, όπου αυτό είναι εφικτό.

Η προσέγγιση αυτή συνοδεύεται από σημαντικές προκλήσεις, κυρίως ως προς την επαλήθευση της συμμόρφωσης και την προστασία της τεχνογνωσίας. Παρ’ όλα αυτά, ο παγκόσμιος χαρακτήρας της τεχνητής νοημοσύνης καθιστά δύσκολη οποιαδήποτε αποτελεσματική πολιτική που περιορίζεται σε μία μόνο χώρα ή ομάδα κρατών.

Από τον «αγώνα προς τα κάτω» στον «αγώνα προς την κορυφή»

Ο Αμοντέι προειδοποιεί ότι ο ανταγωνισμός για εμπορικό πλεονέκτημα μπορεί να οδηγήσει τις εταιρείες σε έναν «αγώνα προς τα κάτω», όπου η ταχύτητα και τα κέρδη θα υπερισχύουν της ασφάλειας. Η Anthropic θέλει να προωθήσει το αντίθετο μοντέλο: έναν «αγώνα προς την κορυφή», στον οποίο οι εταιρείες θα ανταγωνίζονται για την αξιοπιστία, τη διαφάνεια και την αποτελεσματική προστασία των χρηστών.

Η εταιρεία δεν υποστηρίζει ότι η ανάπτυξη πρέπει να σταματήσει. Υποστηρίζει, όμως, ότι η εξέλιξη των μοντέλων πρέπει να συμβαδίζει με την κατανόηση των κινδύνων τους. Η τεχνητή νοημοσύνη μπορεί να προσφέρει τεράστια οφέλη, αλλά μόνο εφόσον η καινοτομία συνοδεύεται από υπευθυνότητα, ανεξάρτητο έλεγχο και διεθνή συνεργασία.

Δείτε επίσης

Τελευταία Άρθρα

Τα πιο Δημοφιλή