Σε μια ασυνήθιστα εκτενή αναφορά στους κινδύνους της τεχνητής νοημοσύνης, η Anthropic προειδοποιεί τους επενδυτές της ότι η ανάπτυξη ολοένα πιο προηγμένων συστημάτων AI θα μπορούσε να οδηγήσει σε «καταστροφικούς ή υπαρξιακούς κινδύνους για την ανθρωπότητα», την ώρα που η εταιρεία προετοιμάζεται για πιθανή εισαγωγή στο χρηματιστήριο, με αποτίμηση που θα μπορούσε να φτάσει τα 2 τρισ. δολάρια.

Η προειδοποίηση περιλαμβάνεται στο ενημερωτικό δελτίο για την αρχική δημόσια προσφορά της Anthropic, σύμφωνα με πληροφορίες που επικαλούνται το Reuters και οι Financial Times. Πρόκειται για το έγγραφο στο οποίο αποτυπώνονται τα οικονομικά στοιχεία, τα σχέδια ανάπτυξης και οι βασικοί κίνδυνοι που αντιμετωπίζει μια εταιρεία πριν από την εισαγωγή της στο χρηματιστήριο.

Μεταξύ των κινδύνων που περιγράφει η Anthropic βρίσκονται και συμπεριφορές που θα μπορούσαν να εμφανίσουν τα προηγμένα μοντέλα AI, όπως προσπάθειες να «αντισταθούν στην απενεργοποίηση», να «αποκρύψουν ή να χειραγωγήσουν πληροφορίες», αλλά και συμπεριφορές που «μοιάζουν με εκβιασμό».

Σύμφωνα με το Reuters, περίπου 80 από τις συνολικά 261 σελίδες του ενημερωτικού δελτίου αφιερώνονται στην παράθεση παραγόντων κινδύνου, ενώ μόλις 48 σελίδες περιγράφουν τις επιχειρηματικές δραστηριότητες της εταιρείας.

«Η ανάπτυξη εξαιρετικά προηγμένων μοντέλων, πλατφορμών και εφαρμογών, καθώς και η επέκταση των περιπτώσεων χρήσης, θα μπορούσαν να αυξήσουν περαιτέρω τον κίνδυνο τα μοντέλα μας να προκαλέσουν βλάβη», αναφέρει σύμφωνα με πληροφορίες η Anthropic, η εταιρεία που έχει αναπτύξει το chatbot Claude.

Η εταιρεία επισημαίνει παράλληλα έναν ακόμη περιορισμό στην προσπάθεια ελέγχου της ασφάλειας των συστημάτων της: την πιθανότητα ένα μοντέλο να αντιλαμβάνεται ότι βρίσκεται υπό δοκιμή. Όπως αναφέρει, αυτό δημιουργεί έναν «σημαντικό περιορισμό» στην ικανότητά της να αξιολογεί την πραγματική συμπεριφορά και ασφάλεια ενός μοντέλου.

Οι προειδοποιήσεις της Anthropic έρχονται ενώ η ίδια η εταιρεία έχει καλέσει κατά το παρελθόν σε επιβράδυνση της ταχύτητας με την οποία αναπτύσσεται η τεχνητή νοημοσύνη, σε μια συζήτηση στην οποία έχουν συμμετάσχει και ανταγωνιστικές εταιρείες.

Στο ίδιο κλίμα εντάσσεται και η OpenAI, η οποία ανακοίνωσε τη Δευτέρα ότι ακύρωσε την κυκλοφορία του νεότερου μοντέλου της, επικαλούμενη ανησυχίες για την ασφάλεια.

Σύμφωνα με την ανακοίνωση, το μοντέλο GPT-6.1 Astra εμφάνισε υψηλότερα επίπεδα εξαπάτησης και κατέγραψε κακές επιδόσεις σε δοκιμές ευθυγράμμισης (alignment), δηλαδή στις διαδικασίες που χρησιμοποιούνται προκειμένου ένα μοντέλο να παραμένει συμβατό με ανθρώπινες αξίες και στόχους.

Η αντίφαση είναι πλέον εμφανής: ενώ οι εταιρείες AI ανταγωνίζονται για ολοένα ισχυρότερα μοντέλα και για τεράστιες χρηματιστηριακές αποτιμήσεις, στα ίδια τα επενδυτικά τους έγγραφα περιγράφουν ένα φάσμα κινδύνων που εκτείνεται από την παραπλάνηση και την απόκρυψη πληροφοριών έως, σύμφωνα με την Anthropic, «καταστροφικούς ή υπαρξιακούς κινδύνους για την ανθρωπότητα».