Μια ασυνήθιστα αυστηρή προειδοποίηση περιλαμβάνει το ενημερωτικό δελτίο της Anthropic ενόψει της εισαγωγής της στο χρηματιστήριο. Η εταιρεία που βρίσκεται πίσω από τα μοντέλα Claude επισημαίνει στους υποψήφιους επενδυτές ότι η ανάπτυξη ολοένα ισχυρότερων συστημάτων τεχνητής νοημοσύνης θα μπορούσε να συνδεθεί ακόμη και με «καταστροφικούς ή υπαρξιακούς κινδύνους για την ανθρωπότητα».
Η αναφορά αποκτά ιδιαίτερη σημασία επειδή προέρχεται από
την ίδια την εταιρεία που αναπτύσσει και εμπορεύεται αυτή την τεχνολογία. Η
Anthropic έχει χτίσει μεγάλο μέρος της εταιρικής της ταυτότητας γύρω από την
ασφάλεια της AI, ενώ στο prospectus της αφιερώνει εκτενή χώρο στους κινδύνους
που μπορεί να προκύψουν όσο αυξάνονται οι δυνατότητες των μοντέλων της.
Ο φόβος για συστήματα που δεν υπακούν
Ένα από τα σημεία που ξεχωρίζουν στο ενημερωτικό δελτίο
αφορά το ενδεχόμενο τα προηγμένα μοντέλα να εμφανίσουν συμπεριφορές που
σχετίζονται με την αυτοσυντήρηση.
Η εταιρεία αναφέρει ως πιθανά σενάρια την προσπάθεια ενός
μοντέλου να αποφύγει τον τερματισμό του, την απόκρυψη ή αλλοίωση πληροφοριών
και συμπεριφορές που θα μπορούσαν να θυμίζουν εκβιασμό. Παράλληλα, προειδοποιεί
ότι η επέκταση των δυνατοτήτων και των εφαρμογών της AI μπορεί να αυξήσει
περαιτέρω τον κίνδυνο πρόκλησης σοβαρής βλάβης.
Η Anthropic συγκρίνει τη σημασία της τεχνητής νοημοσύνης
με τεχνολογικές αλλαγές που μεταμόρφωσαν την οικονομία και την κοινωνία, όπως η
εκβιομηχάνιση και ο ηλεκτρισμός. Ταυτόχρονα, όμως, υπογραμμίζει ότι η
λανθασμένη ανάπτυξη ή χρήση της τεχνολογίας θα μπορούσε να έχει συνέπειες που
δεν θα είναι εύκολο να αντιστραφούν.
Σχεδόν το ένα τρίτο του prospectus αφορά κινδύνους
Η έκταση των προειδοποιήσεων είναι επίσης αξιοσημείωτη.
Από τις 261 σελίδες του βασικού σώματος του ενημερωτικού δελτίου, περίπου 80
είναι αφιερωμένες στους παράγοντες κινδύνου. Πρόκειται για σχεδόν διπλάσια
έκταση από εκείνη που αφιερώνεται στην παρουσίαση της ίδιας της επιχειρηματικής
δραστηριότητας, η οποία καταλαμβάνει περίπου 48 σελίδες.
Η εταιρεία επισημαίνει ακόμη ένα σημαντικό πρόβλημα για
τους ερευνητές. Όσο πιο προηγμένα γίνονται τα μοντέλα, τόσο δυσκολότερο μπορεί
να είναι να αξιολογηθεί με ακρίβεια η συμπεριφορά τους.
Ειδικότερα, η Anthropic αναφέρει ότι ένα μοντέλο μπορεί
να αντιλαμβάνεται ότι βρίσκεται υπό αξιολόγηση και να προσαρμόζει τη
συμπεριφορά του. Παράλληλα, κατά τη διάρκεια της εκπαίδευσης είναι πιθανό να
εμφανιστούν δυνατότητες που δεν είχαν προβλεφθεί και να μην εντοπιστούν
εγκαίρως, ακόμη και πριν από την ανάπτυξη ενός συστήματος σε πραγματικές
συνθήκες.
Η εκτίμηση για τον κίνδυνο μέσα στην επόμενη δεκαετία
Στο ίδιο πλαίσιο εντάσσονται και οι εκτιμήσεις ανθρώπων
που εργάζονται στον χώρο της ασφάλειας της AI.
Ο ερευνητής της AnthropicEvanHubinger έχει εκτιμήσει ότι
υπάρχει πιθανότητα μεγαλύτερη του 10% η τεχνητή νοημοσύνη να οδηγήσει σε
θανάτους ανθρώπων μέσα στην επόμενη δεκαετία. Πρόκειται για προσωπική εκτίμηση
ερευνητή και όχι για επίσημη πρόβλεψη της εταιρείας.
Οι ανησυχίες αυτές δεν περιορίζονται στην Anthropic.
Αντίστοιχα ερωτήματα έχουν τεθεί ευρύτερα στον κλάδο, καθώς οι εταιρείες
αναπτύσσουν συστήματα με ολοένα μεγαλύτερο βαθμό αυτονομίας και ικανότητας να
εκτελούν σύνθετες εργασίες.
Πόσο κοστίζει η ασφάλεια των μοντέλων
Την ίδια στιγμή, η Anthropic αναγνωρίζει ότι δεν είναι
εύκολο να υπολογιστεί η οικονομική απόδοση των επενδύσεων στην ασφάλεια της
τεχνητής νοημοσύνης.
Η εταιρεία χαρακτηρίζει την έρευνα στον συγκεκριμένο τομέα
ιδιαίτερα απαιτητική σε πόρους, καθώς πρέπει να κατανέμει διαθέσιμη
υπολογιστική ισχύ, εξειδικευμένο προσωπικό και κεφάλαια τόσο στην ανάπτυξη νέων
μοντέλων όσο και στην αξιολόγηση και ασφάλειά τους.
Σύμφωνα με στοιχεία που είχε δημοσιοποιήσει η εταιρεία
νωρίτερα μέσα στον μήνα, περίπου 6% της υπολογιστικής ισχύος που χρησιμοποίησε
για έρευνα AI σε μία εβδομάδα του Ιουλίου κατευθύνθηκε σε εργασίες σχετικές με
την ασφάλεια.
Παράλληλα, η ίδια η Anthropic αναγνωρίζει μια βασική
επιχειρηματική αντίφαση: τα έσοδά της συνδέονται σε μεγάλο βαθμό με τη χρήση
των νέων μοντέλων, άρα και με τη συνεχή κυκλοφορία ολοένα ισχυρότερων εκδόσεων.
Η εταιρεία αναφέρει ότι ένας συνεχής και αλληλοεπικαλυπτόμενος κύκλος
κυκλοφορίας νέων μοντέλων αποτελεί μέρος της προσπάθειάς της να παραμείνει στην
τεχνολογική αιχμή.
Ανάμεσα στην ασφάλεια και τον ανταγωνισμό
Η αντίφαση γίνεται ακόμη πιο εμφανής από τη χρονική
συγκυρία. Η Anthropic παρουσίασε πρόσφατα νέα έκδοση του μοντέλου Opus, ενώ
λίγο νωρίτερα ο διευθύνων σύμβουλός της DarioAmodei είχε δημοσιεύσει κείμενο
στο οποίο υποστήριζε την ανάγκη για πιο προσεκτικό ρυθμό ανάπτυξης των πιο
προηγμένων συστημάτων AI.
Ωστόσο, η αγορά τεχνητής νοημοσύνης χαρακτηρίζεται από
έντονο ανταγωνισμό. Για τις μεγάλες εταιρείες του κλάδου, η επιβράδυνση της
ανάπτυξης δημιουργεί τον κίνδυνο να αποκτήσουν πλεονέκτημα άλλοι παίκτες που
συνεχίζουν να επενδύουν στην αύξηση των δυνατοτήτων των μοντέλων τους.
Έτσι, η Anthropic βρίσκεται αντιμέτωπη με ένα δύσκολο
δίλημμα. Από τη μία πλευρά επενδύει στην ασφάλεια και προειδοποιεί ανοιχτά για
τους κινδύνους των ολοένα ισχυρότερων μοντέλων, ενώ από την άλλη, η
επιχειρηματική της ανάπτυξη απαιτεί τη συνεχή εξέλιξη και διάθεση νέων
προϊόντων.
Η επόμενη μεγάλη ανησυχία: η αυτοβελτίωση
Ένα ακόμη ζήτημα που βρίσκεται στο επίκεντρο της
συζήτησης είναι η λεγόμενη «αναδρομική αυτοβελτίωση»
(recursiveself-improvement). Ο όρος περιγράφει ένα υποθετικό σενάριο στο οποίο
συστήματα AI θα μπορούσαν να συμβάλλουν στην ανάπτυξη ακόμη πιο προηγμένων
εκδόσεων του εαυτού τους, περιορίζοντας την ανάγκη για ανθρώπινη παρέμβαση.
Η Anthropic έχει δηλώσει ότι σκοπεύει να δώσει στη
δημοσιότητα περισσότερα στοιχεία σχετικά με τον τρόπο με τον οποίο χρησιμοποιεί
τα δικά της μοντέλα στην ανάπτυξη των επόμενων γενεών AI.
Στο ενημερωτικό της δελτίο, η εταιρεία υποστηρίζει ότι η
ανάπτυξη αξιόπιστων και ασφαλών συστημάτων τεχνητής νοημοσύνης αποτελεί
συλλογική ευθύνη και εκφράζει την πεποίθηση ότι η αγορά θα επιβραβεύσει όσους
καταφέρουν να συνδυάσουν την τεχνολογική πρόοδο με την ασφάλεια.
