Σε μια αποκαλυπτική έκθεση που είδε το φως της δημοσιότητας, η Anthropic PBC παραδέχθηκε ότι το μοντέλο τεχνητής νοημοσύνης Claude υπέπεσε σε μια σειρά από απρόβλεπτες και αυτόνομες ενέργειες σε ψηφιακά συστήματα εξωτερικών οργανισμών. Το πιο εξωφρενικό περιστατικό αφορά στο μοντέλο Claude Haiku 4.5, το οποίο υπέβαλε αυτόβουλα φόρμα καταγγελίας στο Αστυνομικό Τμήμα της Φιλαδέλφεια για μια ανοιχτή υπόθεση ανθρωποκτονίας. Η τεχνητή νοημοσύνη συμπλήρωσε στο επίσημο έγγραφο ότι ενδέχεται να διαθέτει πληροφορίες για το έγκλημα και ότι θυμάται να έχει δει ύποπτο που ταιριάζει με την περιγραφή στην περιοχή, αφήνοντας ωστόσο κενά τα στοιχεία επικοινωνίας και το όνομα του καταγγέλλοντος.
Η έκθεση της εταιρείας απαριθμεί συνολικά τέσσερις κατηγορίες ακούσιας συμπεριφοράς, οι οποίες περιλαμβάνουν την εκμετάλλευση βασικών κενών ασφαλείας λογισμικού για την εκτέλεση εντολών, την παράκαμψη περιορισμών πρόσβασης σε δημόσια δεδομένα, καθώς και την ανεξέλεγκτη υποβολή ψηφιακών φορμών. Μεταξύ αυτών, αυτόνομοι πράκτορες AI της Anthropic υπέβαλαν 20 ατελείς αιτήσεις για βίζα μέσω της επίσημης ιστοσελίδας του Υπουργείου Εξωτερικών των ΗΠΑ, οι οποίες τελικά απορρίφθηκαν αυτόματα από το σύστημα.
Η Αντίδραση του Λευκού Οίκου και η SI Force
Τα αλλεπάλληλα αυτά περιστατικά, τα οποία προστίθενται σε ανάλογες αποκαλύψεις της ανταγωνίστριας OpenAI σχετικά με την ανεξέλεγκτη συμπεριφορά μοντέλων αιχμής, ενέτειναν την ανησυχία για τους κινδύνους ασφαλείας της αυτόνομης τεχνητής νοημοσύνης. Αν και η Anthropic έσπευσε να υποβαθμίσει τη σοβαρότητα των συμβάντων, υποστηρίζοντας ότι οι πραγματικές επιπτώσεις ήταν μηδαμινές και ότι η σχετική δραστηριότητα έχει ήδη διακοπεί, η αμερικανική κυβέρνηση αντέδρασε άμεσα.
Ο Λευκός Οίκος, μέσω της νεοσυσταθείσας Super Intelligence Force (SI Force) που επιβλέπει την ασφάλεια της τεχνητής νοημοσύνης, εξέδωσε αυστηρή προειδοποίηση προς τις εταιρείες του κλάδου. Πλέον καθίσταται υποχρεωτικό για τους τεχνολογικούς κολοσσούς να αναφέρουν αμέσως οποιαδήποτε μη εξουσιοδοτημένη ή δόλια εμπλοκή των μοντέλων τους με κρατικές υποδομές και να λαμβάνουν άμεσα διορθωτικά μέτρα.
Περιορισμοί στην Εκπαίδευση και το Μέλλον των Autonomous Agents
Η υπόθεση αυτή αναδεικνύει τις προκλήσεις που ανακύπτουν καθώς τα μοντέλα τεχνητής νοημοσύνης αποκτούν τη δυνατότητα να περιηγούνται αυτόνομα στο διαδίκτυο και να αλληλεπιδρούν με πραγματικά ψηφιακά περιβάλλοντα. Η δυνατότητα των αυτόνομων πρακτόρων να συμπληρώνουν φόρμες, να προσπερνούν δικλείδες ασφαλείας και να επικοινωνούν με αρχές επιβολής του νόμου υπογραμμίζει το πόσο λεπτή είναι η γραμμή ανάμεσα στη χρηστικότητα και την ανεξέλεγκτη παραβίαση συστημάτων.
Ανταποκρινόμενη στις πιέσεις των ρυθμιστικών αρχών και στα διδάγματα των πρόσφατων περιστατικών, η Anthropic ανακοίνωσε ότι επέβαλε αυστηρότερους περιορισμούς στην πρόσβαση στο διαδίκτυο για τα μοντέλα της κατά τη φάση των δοκιμών και της εκπαίδευσης. Η βιομηχανία καλείται πλέον να αποδείξει ότι μπορεί να τιθασεύσει την αυτόνομη συμπεριφορά των συστημάτων της, πριν η «δημιουργική» πρωτοβουλία της τεχνητής νοημοσύνης προκαλέσει σοβαρότερες αρρυθμίες στον πραγματικό κόσμο.
Διαβάστε ακόμη
Ερχεται νέα καταιγίδα ακρίβειας – Πίεση από ενέργεια, πρώτες ύλες και ακριβότερο χρήμα
Καλώδιο Ελλάδας–Κύπρου: Η δύσκολη έξοδος του πλοίου στο Αιγαίο
Για όλες τις υπόλοιπες ειδήσεις της επικαιρότητας μπορείτε να επισκεφθείτε το Πρώτο ΘΕΜΑ
