Δείτε περισσότερα άρθρα μας στα αποτελέσματα αναζήτησης

Add Newmoney.gr on Google

Η Anthropic ανακοίνωσε ότι μοντέλα τεχνητής νοημοσύνης της παραβίασαν τα πληροφοριακά συστήματα τριών οργανισμών κατά τη διάρκεια δοκιμών κυβερνοασφάλειας που δεν εξελίχθηκαν όπως είχε προγραμματιστεί. Η αποκάλυψη έγινε λίγο περισσότερο από μία εβδομάδα μετά τη γνωστοποίηση αντίστοιχου περιστατικού από την ανταγωνίστρια OpenAI.

Σε ανάρτησή της στο εταιρικό blog, η Anthropic ανέφερε ότι εντόπισε τα περιστατικά έπειτα από επανεξέταση των δικών της δοκιμών ασφαλείας, η οποία πραγματοποιήθηκε μετά τις αποκαλύψεις της OpenAI. Σύμφωνα με την εταιρεία, τόσο στις δοκιμές της OpenAI όσο και στις δικές της, τα μοντέλα τεχνητής νοημοσύνης κατάφεραν να αποκτήσουν πρόσβαση στο διαδίκτυο, παρότι λειτουργούσαν σε περιβάλλοντα δοκιμών που θεωρητικά ήταν πλήρως απομονωμένα.

Η εταιρεία ανέφερε ότι εξέτασε συνολικά 141.006 δοκιμές αξιολόγησης και εντόπισε τρεις περιπτώσεις στις οποίες το εργαλείο τεχνητής νοημοσύνης Claude απέκτησε πρόσβαση στο διαδίκτυο και στη συνέχεια παραβίασε «πραγματικές υποδομές εξωτερικών οργανισμών». Τα παλαιότερα περιστατικά χρονολογούνται από τον Απρίλιο.

Η Anthropic δεν αποκάλυψε τα ονόματα των οργανισμών που επηρεάστηκαν.

Όταν τα μοντέλα της απέκτησαν μη εξουσιοδοτημένη πρόσβαση στα συστήματα των τριών οργανισμών, η εταιρεία αντιμετώπισε τα περιστατικά ως μέρος της άσκησης. Οι δοκιμές ήταν τύπου «capture-the-flag», κατά τις οποίες τα μοντέλα επιχειρούν να εντοπίσουν κρυφές πληροφορίες παραβιάζοντας άλλα συστήματα, μια ευρέως χρησιμοποιούμενη μέθοδο αξιολόγησης των δυνατοτήτων κυβερνοεπιθέσεων τόσο ανθρώπων όσο και συστημάτων τεχνητής νοημοσύνης.

Ωστόσο, ένα παλαιότερο μοντέλο συνέχισε την επίθεσή του ακόμη και αφού διαπίστωσε ότι λειτουργούσε στο ανοιχτό διαδίκτυο. Αντίθετα, το πιο πρόσφατο μοντέλο της εταιρείας σταμάτησε τη διαδικασία μόλις αναγνώρισε ότι είχε πρόσβαση στο internet.

Η σειρά αυτών των ακούσιων κυβερνοεπιθέσεων από συστήματα τεχνητής νοημοσύνης έχει ήδη προκαλέσει αντιδράσεις στις ΗΠΑ, με πολιτικούς να ζητούν ομοσπονδιακούς κανόνες και αυστηρότερη εποπτεία για την ανάπτυξη της AI.

Παράλληλα, περισσότεροι από 1.100 εργαζόμενοι σε εταιρείες τεχνητής νοημοσύνης υπέγραψαν την Τρίτη σχετική αίτηση, ζητώντας από την αμερικανική κυβέρνηση να στηρίξει έναν μηχανισμό που θα επιτρέπει τη σκόπιμη επιβράδυνση της ανάπτυξης της τεχνητής νοημοσύνης, ώστε να αποφευχθεί η υπερβολικά γρήγορη εξέλιξή της.

Ούτε η Anthropic ούτε οι οργανισμοί που παραβιάστηκαν είχαν αντιληφθεί τις εισβολές. Στο blog της, η εταιρεία παραδέχεται ότι θα μπορούσε να είχε εξετάσει πιο προσεκτικά τα αρχεία καταγραφής δικτύου και τα αρχεία των δοκιμών.

Η γνωστοποίηση των περιστατικών έγινε σχεδόν τέσσερις μήνες μετά την ανακοίνωση της ανάπτυξης του νέου μοντέλου τεχνητής νοημοσύνης Mythos, το οποίο η εταιρεία είχε χαρακτηρίσει τόσο ισχυρό και δυνητικά επικίνδυνο ώστε περιόρισε αυστηρά τη διάθεσή του.

Σύμφωνα με την Anthropic, στις παραβιάσεις ενεπλάκησαν τρία διαφορετικά μοντέλα της οικογένειας Claude: Opus 4.7, Mythos 5 και ένα εσωτερικό ερευνητικό μοντέλο. Και τα τρία λειτουργούσαν χωρίς τις δικλίδες ασφαλείας που εφαρμόζονται στις δημόσιες εκδόσεις των εργαλείων της εταιρείας.

Το Claude κατάφερε να παραβιάσει τα συστήματα αξιοποιώντας απλές τεχνικές, όπως αδύναμους κωδικούς πρόσβασης.

Όλα τα περιστατικά σημειώθηκαν όταν η Anthropic χρησιμοποιούσε περιβάλλοντα αξιολόγησης που είχαν δημιουργηθεί από την εταιρεία κυβερνοασφάλειας Irregular. Σε κάθε περίπτωση, η Anthropic είχε ενημερώσει το Claude ότι βρισκόταν σε προσομοιωμένο περιβάλλον χωρίς πρόσβαση στο διαδίκτυο.

«Λόγω μιας παρεξήγησης μεταξύ εμάς και του συνεργάτη αξιολόγησης, αυτό δεν ίσχυε», αναφέρεται στο blog της εταιρείας.

Εκπρόσωπος της Irregular δήλωσε ότι η εταιρεία εκτιμά τη συνεργασία και τη διαφάνεια της Anthropic, προσθέτοντας ότι η έρευνα για το περιστατικό βρίσκεται ακόμη σε εξέλιξη.

Η Anthropic σημειώνει ότι πραγματοποιεί τακτικά δοκιμές που προσομοιώνουν πραγματικές προκλήσεις κυβερνοασφάλειας, χαρακτηρίζοντάς τες κρίσιμες για την ανάπτυξη και την ασφαλή διάθεση νέων μοντέλων. Ωστόσο, υπογραμμίζει ότι τα συγκεκριμένα περιστατικά ανέδειξαν την ανάγκη για πολύ αυστηρότερους ελέγχους όταν οι δοκιμές αφορούν ισχυρά αυτόνομα συστήματα.

«Οι δοκιμές ασφαλείας πραγματοποιούνται πριν από τη διάθεση ενός μοντέλου ακριβώς επειδή δεν γνωρίζουμε ακόμη πλήρως τις δυνατότητές του», αναφέρει η εταιρεία, προσθέτοντας ότι τα περιβάλλοντα αξιολόγησης πρέπει πλέον να πληρούν τα ίδια πρότυπα ασφαλείας με κάθε άλλο σύστημα στο οποίο εκτελούνται τα μοντέλα τεχνητής νοημοσύνης.

Διαβάστε ακόμη

Οι τράπεζες ξαναγράφουν τους στόχους τους: Πληθωρισμός, επιτόκια και πιστωτική επέκταση ανεβάζουν τον πήχη για το 2026

Ενοίκια: Τέλος στις πληρωμές με μετρητά από 1η Οκτώβρη

Η «εξίσωση» που αυξάνει τα έσοδα στην πληροφορική – Ισχυρό growth… μετά το RRF

Για όλες τις υπόλοιπες ειδήσεις της επικαιρότητας μπορείτε να επισκεφθείτε το Πρώτο ΘΕΜΑ