Ένα εργαλείο σχεδιασμένο για να γράφει κείμενα, να αναλύει δεδομένα και να βοηθά στην έρευνα βρέθηκε μπροστά σε ένα πολύ πιο σκοτεινό ενδεχόμενο. Η Anthropic, η εταιρεία πίσω από το Claude, ανακοίνωσε ότι απέκλεισε λογαριασμούς οι οποίοι χρησιμοποιούσαν τα μοντέλα της σε επιστημονικές εργασίες που θα μπορούσαν να συμβάλουν στην ανάπτυξη βιολογικών όπλων.

Η διατύπωση χρειάζεται προσοχή. Η εταιρεία δεν ισχυρίζεται ότι ανακάλυψε ολοκληρωμένα σχέδια επίθεσης ούτε ότι επιβεβαίωσε κακόβουλες προθέσεις. Αναφέρει, ωστόσο, ότι εντόπισε δραστηριότητα αρκετά ανησυχητική ώστε να διακόψει την πρόσβαση των συγκεκριμένων χρηστών. Σύμφωνα με την αναφορά της Anthropic, πρόκειται για μία από τις σοβαρότερες μορφές πιθανής κατάχρησης της τεχνητής νοημοσύνης.
Η έκθεση παρουσιάζει πέντε πραγματικές περιπτώσεις χρηστών, τους οποίους η Anthropic περιγράφει ως ενεργούς επιστήμονες. Ορισμένοι φέρονται να προσπάθησαν να παρακάμψουν γεωγραφικούς περιορισμούς ή να αποκρύψουν τον πραγματικό στόχο των ερωτημάτων τους, ώστε να αποφύγουν τις δικλίδες ασφαλείας. Η εταιρεία δεν αποκάλυψε τα ονόματα, τις χώρες ή τα ερευνητικά ιδρύματα με τα οποία συνδέονταν.
Σε έλεγχο δραστηριότητας 30 ημερών εντοπίστηκαν περίπου 35 διαφορετικές ερευνητικές προσπάθειες που θεωρήθηκαν δυνητικά ανησυχητικές. Η Anthropic παραδέχεται ότι δεν μπορούσε να γνωρίζει εάν πίσω από αυτές υπήρχε πρόθεση πρόκλησης βλάβης ή νόμιμη επιστημονική έρευνα. Αυτό ακριβώς είναι και το πιο δύσκολο σημείο της υπόθεσης, καθώς η ίδια γνώση μπορεί να χρησιμοποιηθεί για την ανάπτυξη ενός φαρμάκου, αλλά και για έναν πολύ πιο επικίνδυνο σκοπό.

Μία περίπτωση αφορούσε τη σύνταξη αίτησης χρηματοδότησης για έρευνα σχετική με τον ιό chikungunya και χαρακτηριστικά όπως η μεταδοτικότητά του και η αποφυγή της ανοσολογικής απόκρισης. Άλλη σχετιζόταν με τη γρίπη των πτηνών και την προσαρμογή ιών στα θηλαστικά. Στην έκθεση περιλαμβάνονται επίσης αναφορές σε ορθοποξοϊούς (την οικογένεια ιών στην οποία ανήκουν η ευλογιά και η mpox) καθώς και σε τοξίνες. Οι πληροφορίες αυτές παρουσιάζονται σε γενικό επίπεδο, χωρίς επιχειρησιακές λεπτομέρειες.
Το πρόβλημα γίνεται μεγαλύτερο όσο τα μοντέλα αποκτούν την ικανότητα να εκτελούν σύνθετες επιστημονικές εργασίες που μέχρι πρόσφατα απαιτούσαν εξειδικευμένους ερευνητές. Η AI μπορεί να επιταχύνει την ανακάλυψη φαρμάκων και νέων θεραπειών, αλλά η ίδια ταχύτητα μπορεί να μειώσει τα εμπόδια για κάποιον με επικίνδυνες προθέσεις.

Η Anthropic υποστηρίζει ότι τα νεότερα μοντέλα της, ανάμεσά τους το Claude Fable 5, διαθέτουν αυστηρότερες δικλίδες για ερωτήματα βιολογικής έρευνας διττής χρήσης. Αναγνωρίζει, όμως, ότι τα συστήματα προστασίας θα πρέπει να εξελίσσονται διαρκώς. Στην ίδια έκθεση αναφέρονται προσπάθειες κατάχρησης του Claude για παρακολούθηση, απάτες, κυβερνοεπιθέσεις και ανάπτυξη συμβατικών όπλων.
Η αποκάλυψη αφήνει ένα ερώτημα που δεν αφορά πλέον το μακρινό μέλλον. Όταν οι εταιρείες AI μπορούν να βλέπουν απειλές που ίσως δεν εντοπίζουν ούτε οι κυβερνήσεις, ποιος ελέγχει τελικά εκείνους που κρατούν τον διακόπτη;
Με πληροφορίες από Associated Press


