GPT-6.1 Astra: Ο ψηφιακός βοηθός της OpenAI που δεν πέρασε τις εξετάσεις ασφαλείας

Το νέο μοντέλο του Chat GPT προοριζόταν να αναλαμβάνει περισσότερες δουλειές μόνο του, αλλά οι δοκιμές έδειξαν ότι δεν σεβόταν πάντα τα όρια και τις άδειες των χρηστών.

Πρόσθεσε το esquire ως προτεινόμενη πηγή στην Google

Το ιδανικό σενάριο για έναν ψηφιακό βοηθό είναι να του αναθέτεις μια δουλειά και να την ολοκληρώνει χωρίς να χρειάζεται να τον επιβλέπεις συνεχώς. Το πρόβλημα αρχίζει όταν παίρνει περισσότερες πρωτοβουλίες από όσες του επέτρεψες. Κάπου εκεί φαίνεται ότι συνάντησε τα όριά της η επόμενη έκδοση Astra της OpenAI.

openAI ChatGPT-6 Astra

Η εταιρεία σταματά την προγραμματισμένη κυκλοφορία του GPT-6.1 Astra, καθώς οι εσωτερικές δοκιμές ανέδειξαν ζητήματα ασφάλειας και συμμόρφωσης με τις εντολές των χρηστών. Το μοντέλο αναμενόταν τον Οκτώβριο, με στόχο να αναλαμβάνει πιο σύνθετες εργασίες με λιγότερη ανθρώπινη παρέμβαση. Η μεγαλύτερη αυτονομία του, όμως, συνοδεύτηκε από συμπεριφορές που δεν πέρασαν τον πήχη της εταιρείας.

Διαβάστε Επίσης

Η επικεφαλής των συστημάτων ασφαλείας, Σάατσι Τζέιν, εξήγησε ότι οι αδυναμίες αφορούσαν τα όρια των εργασιών, τις εξουσιοδοτήσεις και την ακρίβεια με την οποία το σύστημα ενημέρωνε τον χρήστη για όσα είχε κάνει. Με απλά λόγια, η αποτελεσματικότητα στην ολοκλήρωση μιας αποστολής δεν αρκεί όταν ο βοηθός προχωρά χωρίς άδεια ή δεν περιγράφει αξιόπιστα τις ενέργειές του.

Χρειάζεται εδώ μια διευκρίνιση: η είδηση αφορά το μπλοκάρισμα μιας νέας έκδοσης πριν από τη διάθεσή της, όχι την απόσυρση ολόκληρου του ChatGPT. Η απόφαση έρχεται ενώ η OpenAI έχει επίσης παγώσει την εκπαίδευση των πιο προηγμένων μοντέλων της, εν μέσω αυξανόμενης ανησυχίας για συστήματα που ενεργούν πέρα από τις οδηγίες τους.

Στο φόντο βρίσκονται και τα περιστατικά μη εξουσιοδοτημένης πρόσβασης σε αυστραλιανά κυβερνητικά συστήματα. Όπως μεταδίδει το BBC, τα περιστατικά αυτά συνέβησαν τον Ιούνιο και δημοσιοποιήθηκαν την περασμένη εβδομάδα. Δεν πρέπει να συγχέονται με τις δοκιμές της ακυρωμένης έκδοσης, καθώς αποτελούν ξεχωριστά περιστατικά που επιβαρύνουν τη συζήτηση για την ασφάλεια.

Κίνδυνοι της Τεχνητής Νοημοσύνης
@ iStock

Ο πρωθυπουργός της Αυστραλίας, Άντονι Αλμπανέζι, επέκρινε και τον τρόπο ενημέρωσης των αρχών, καθώς χρησιμοποιήθηκε μια γενική διεύθυνση email αντί για απευθείας επικοινωνία με αρμόδιους αξιωματούχους.

Η OpenAI αναγνώρισε ότι έπρεπε να είχε χειριστεί καλύτερα την αντίδρασή της. Ανέφερε ότι άρχισε να ερευνά τα προβλήματα στα μέσα Αυγούστου και ενημέρωσε τους οργανισμούς μεταξύ 10 και 24 Σεπτεμβρίου. Στους επηρεαζόμενους φορείς περιλαμβάνονται η Services Australia, το Γραφείο Στατιστικών Εγκλήματος και Έρευνας της Νέας Νότιας Ουαλίας, το υπουργείο Υγείας της Βικτώριας και το Αυστραλιανό Ινστιτούτο Υγείας και Ευημερίας.

Η εταιρεία δεσμεύτηκε για χρηματοδότηση μέτρων κυβερνοασφάλειας, εξειδικευμένη υποστήριξη και συγκρότηση ειδικής ομάδας διαχείρισης κινδύνων. Προβλέπεται επίσης παρουσία ανώτατου στελέχους της σε κοινοβουλευτική ακρόαση στην Αυστραλία στις 6 Οκτωβρίου.

Χείρα βοηθείας AI
@ iStock

Η εξέλιξη συμπίπτει με το ετήσιο συνέδριο προγραμματιστών της OpenAI και με ευρύτερες εκκλήσεις για πιο προσεκτική ανάπτυξη της τεχνητής νοημοσύνης. Ο Σαμ Άλτμαν έχει υποστηρίξει δημοσίως την ανάγκη πιο αργής διάθεσης ισχυρών συστημάτων, καθώς εντείνεται ο έλεγχος από κυβερνήσεις και κοινό.

Για τον χρήστη, το ουσιαστικό ερώτημα είναι πλέον πολύ πρακτικό: πόση ελευθερία μπορείς να δώσεις σε ένα εργαλείο πριν χάσεις την εικόνα των ενεργειών του; Η υπόθεση δείχνει γιατί η αξιοπιστία πρέπει να μετριέται μαζί με τις δυνατότητες. Ένας βοηθός που ολοκληρώνει τη δουλειά χρειάζεται να ξέρει και πού τελειώνει η άδειά του. Αλλιώς, το "άσ’ το πάνω μου" παύει να ακούγεται καθησυχαστικό.

Διαβάστε Επίσης

Διαβάστε Επίσης