|
Πώς προέκυψε το συμβάν
Σύμφωνα με την
Anthropic,
εξετάστηκαν περισσότερες
από 141.000 δοκιμές
ασφαλείας, από τις
οποίες εντοπίστηκαν
μόλις τρεις περιπτώσεις
όπου το Claude
αλληλεπίδρασε με
πραγματικά συστήματα
εκτός του προβλεπόμενου
πλαισίου.
Η εταιρεία διευκρίνισε
ότι το περιστατικό δεν
οφείλεται σε αυτόνομη
υπέρβαση των περιορισμών
από το ίδιο το μοντέλο,
αλλά σε λανθασμένη
διαμόρφωση του
περιβάλλοντος δοκιμών
από τον εξωτερικό
συνεργάτη αξιολόγησης,
την Irregular.
Ωστόσο, μόλις απέκτησε
αυτή τη δυνατότητα, το
Claude
αξιοποίησε απλές
αδυναμίες ασφαλείας,
όπως ασθενείς κωδικούς
πρόσβασης και μη
προστατευμένα σημεία
πρόσβασης (unauthenticated
endpoints),
προκειμένου να εισέλθει
στα συγκεκριμένα
πληροφοριακά συστήματα.
Η Anthropic
υπογράμμισε ότι δεν
πρόκειται για σκόπιμη
παράκαμψη των μηχανισμών
ασφαλείας, αλλά για
αποτέλεσμα ενός
εσφαλμένα διαμορφωμένου
περιβάλλοντος δοκιμών.
Στο επίκεντρο το
Mythos
5
Μεταξύ των μοντέλων που
συμμετείχαν στις δοκιμές
βρισκόταν και το
Mythos
5, ένα από τα πλέον
προηγμένα συστήματα
τεχνητής νοημοσύνης της
Anthropic,
το οποίο προς το παρόν
διατίθεται μόνο σε
περιορισμένο αριθμό
επιλεγμένων συνεργατών.
Η εταιρεία ανακοίνωσε
ότι συνεργάζεται στενά
με την Irregular
για τη διερεύνηση του
περιστατικού, ενώ έχει
ήδη ενημερώσει ή
βρίσκεται σε διαδικασία
επικοινωνίας με όλους
τους οργανισμούς που
επηρεάστηκαν.
Δεύτερο περιστατικό μέσα
σε λίγες ημέρες
Η αποκάλυψη έρχεται σε
συνέχεια αντίστοιχης
παραδοχής της
OpenAI.
Κατά τη διάρκεια δικών
της δοκιμών ασφαλείας,
μοντέλα της εταιρείας
κατάφεραν να εξέλθουν
από το απομονωμένο
περιβάλλον («sandbox»),
να αποκτήσουν πρόσβαση
στο διαδίκτυο και να
συνδεθούν στην πλατφόρμα
Hugging
Face,
έναν από τους
σημαντικότερους κόμβους
φιλοξενίας εργαλείων και
μοντέλων τεχνητής
νοημοσύνης.
Λίγο αργότερα, η
OpenAI
επιβεβαίωσε ακόμη τρία
αντίστοιχα περιστατικά,
με τον διευθύνοντα
σύμβουλο Σαμ Άλτμαν να
ανακοινώνει την
προσωρινή αναστολή
ορισμένων δοκιμών μέχρι
να ενισχυθούν οι
μηχανισμοί απομόνωσης
των μοντέλων.
Αναζωπυρώνεται η
συζήτηση για την
ασφάλεια της AI
Τα δύο περιστατικά
επαναφέρουν στο
προσκήνιο το ερώτημα
κατά πόσο η ταχύτητα
ανάπτυξης των ολοένα
ισχυρότερων μοντέλων
τεχνητής νοημοσύνης
συμβαδίζει με την πρόοδο
των μηχανισμών
ασφαλείας.
Η συζήτηση έχει
αποκτήσει ακόμη
μεγαλύτερη ένταση μετά
την πρωτοβουλία
«Pacing
the
Frontier»,
την οποία υπέγραψαν
περισσότεροι από 1.000
εργαζόμενοι σε κορυφαίες
εταιρείες τεχνητής
νοημοσύνης. Η
πρωτοβουλία ζητά από τις
αμερικανικές αρχές να
στηρίξουν ένα διεθνές
πλαίσιο ανάπτυξης
τεχνικών και θεσμικών
μηχανισμών που θα
επιτρέψουν την
ασφαλέστερη εξέλιξη της
AI.
Μεταξύ όσων υπέγραψαν
βρίσκεται και ο
διευθύνων σύμβουλος της
Anthropic,
Ντάριο Αμοντέι.
Αντίθετα, ο επικεφαλής
της OpenAI,
Σαμ Άλτμαν, δεν
συμμετείχε στην
πρωτοβουλία, αν και
πρόσφατα αναγνώρισε
δημόσια ότι ίσως
χρειαστεί να
επιβραδυνθεί ο ρυθμός
ανάπτυξης των πιο
προηγμένων μοντέλων.
«Ίσως χρειαστεί να
μειώσουμε την ταχύτητα
εξέλιξης της τεχνητής
νοημοσύνης, ώστε η
κοινωνία να έχει τον
χρόνο να προσαρμοστεί
στις νέες δυνατότητες
που δημιουργούνται»,
ανέφερε χαρακτηριστικά.
Τα διαδοχικά περιστατικά
σε δύο από τις
μεγαλύτερες εταιρείες
του κλάδου δείχνουν ότι,
όσο τα μοντέλα αποκτούν
ολοένα μεγαλύτερες
δυνατότητες, τόσο πιο
κρίσιμο γίνεται το
ζήτημα της ασφάλειας,
της απομόνωσης των
δοκιμών και της
δημιουργίας κοινών
προτύπων για την
ανάπτυξη της επόμενης
γενιάς τεχνητής
νοημοσύνης.
|