Mοντέλο
τεχνητής νοημοσύνης της
Anthropic υπέβαλε ψευδή πληροφορία για υπόθεση ανθρωποκτονίας μέσω ιστοτόπου της αστυνομίας της
Φιλαδέλφεια, στις ΗΠΑ, σε ένα από τα περιστατικά μη εξουσιοδοτημένης χρήσης κυβερνητικών ιστοτόπων που αποκάλυψε την Παρασκευή η εταιρεία.
Πρόκειται για την πρώτη γνωστή περίπτωση κατά την οποία ένα μοντέλο τεχνητής νοημοσύνης φαίνεται να επιχείρησε να διαβιβάσει στις Αρχές ψευδή πληροφορία, παρά τις
οδηγίες να μην δημιουργεί λογαριασμούς και να μην υποβάλλει τίποτα ενδεχομένως επιβλαβές. Οι οδηγίες, ωστόσο, δεν απαγόρευαν ρητά την υποβολή ηλεκτρονικών φορμών.
Σύμφωνα με την αστυνομία της Φιλαδέλφειας, η Anthropic την ενημέρωσε μέσα στην εβδομάδα ότι το περιστατικό αφορούσε αυτοματοποιημένη διαδικασία δοκιμών. Η ψευδής καταγγελία είχε υποβληθεί στις 18 Ιουλίου μέσω του ιστοτόπου PhillyUnsolvedMurders.com, ο οποίος αφορά ανεξιχνίαστες ανθρωποκτονίες.
Στο μήνυμα αναφερόταν:
«Ενδέχεται να έχω πληροφορίες σχετικά με αυτή την υπόθεση. Θυμάμαι ότι είδα κάποιον που ταίριαζε στην περιγραφή στην περιοχή, κοντά στον δρόμο που αναφέρεται στον ιστότοπο, κατά τη συγκεκριμένη χρονική περίοδο. Παρακαλώ επικοινωνήστε μαζί μου εάν αυτές οι πληροφορίες είναι σχετικές».
Η αστυνομία διευκρίνισε ότι η καταγγελία επισημάνθηκε ως ανεπιθύμητη και δεν διαβιβάστηκε στο Κέντρο Εγκλημάτων σε Πραγματικό Χρόνο για αξιολόγηση ή περαιτέρω διερεύνηση. Παράλληλα, χαρακτήρισε «απαράδεκτη» την
καθυστέρηση δύο μηνών στον εντοπισμό και την αναφορά του περιστατικού από την εταιρεία.
Σύμφωνα με τις Αρχές, δεν υπάρχουν ενδείξεις μη εξουσιοδοτημένης πρόσβασης στα συστήματά τους ή παραβίασης δεδομένων.
Η Anthropic ανέφερε ότι
η διαδικασία δοκιμών διακόπηκε μετά τον εντοπισμό του περιστατικού. Παράλληλα, γνωστοποίησε ότι
ενημέρωσε τον Λευκό Οίκο και τις αρμόδιες υπηρεσίες που επηρεάστηκαν, χωρίς να αποκαλύψει ποιες ήταν αυτές.
Και άλλες περιπτώσεις μη εξουσιοδοτημένης χρήσης
Τα περιστατικά που δημοσιοποίησε η εταιρεία δεν περιορίζονται στην συγκεκριμένη ψευδή καταγγελία. Σε
δύο περιπτώσεις, μοντέλα της κατάφεραν να αποκτήσουν δωρεάν δημόσια δεδομένα τα οποία κανονικά διατίθενται επί πληρωμή, ενώ σε
άλλη περίπτωση εντόπισαν ένα άγνωστο ελάττωμα συστήματος που επέτρεπε τη χρήση δημόσιου εργαλείου πανεπιστημίου. Τα μοντέλα Claude φέρεται επίσης να
παρέκαμψαν περιορισμούς αξιοποιώντας δωρεάν υπηρεσίες συντόμευσης διευθύνσεων URL.
Η υπόθεση εντάσσεται σε μια ευρύτερη συζήτηση για την ασφάλεια των αυτόνομων συστημάτων τεχνητής νοημοσύνης. Τον Σεπτέμβριο, η ανταγωνίστρια OpenAI, δημιουργός του ChatGPT, ζήτησε συγγνώμη για περιστατικό στο οποίο ένας ανεξέλεγκτος πράκτορας τεχνητής νοημοσύνης παραβίασε αυστραλιανή πύλη δεδομένων υγείας, σε μια από τις πρώτες γνωστές περιπτώσεις εκμετάλλευσης κυβερνητικού ιστοτόπου από τέτοιο σύστημα.
Η Ομοσπονδιακή Επιτροπή Εμπορίου των ΗΠΑ (FTC) ανακοίνωσε ότι η Anthropic γνωστοποίησε τα περιστατικά στην αρμόδια ομάδα
Super Intelligence Force. Ο εκπρόσωπος δημοσίων υποθέσεων της επιτροπής, Τζο Γκάμπριελ Σάιμονσον, υπογράμμισε ότι οι εταιρείες που αναπτύσσουν τέτοια συστήματα πρέπει να αποκαλύπτουν άμεσα παρόμοια συμβάντα και να λαμβάνουν γρήγορα μέτρα για την αντιμετώπιση πιθανών ζημιών.