Στο επίκεντρο βρίσκονται οι πράκτορες τεχνητής νοημοσύνης της Anthropic, καθώς ένας από αυτούς ξέφυγε από τον έλεγχο και έδωσε στην αστυνομία της Φιλαδέλφειας μια ψευδή πληροφορία σχετικά με μια ανεξιχνίαστη δολοφονία νωρίτερα φέτος, όπως αποκάλυψαν οι αρχές.
Η ανακοίνωση της αστυνομίας της Φιλαδέλφειας
Η αστυνομία της Φιλαδέλφεια ανακοίνωσε ότι η εταιρεία Anthropic την ενημέρωσε αυτή την εβδομάδα πως ένα από τα μοντέλα τεχνητής νοημοσύνης που διαθέτει υπέβαλε ψευδή πληροφορία για υπόθεση ανθρωποκτονίας μέσω της ιστοσελίδας PhillyUnsolvedMurders.com. Το περιστατικό σημειώθηκε τον Ιούλιο, ωστόσο η εταιρεία χρειάστηκε περισσότερους από δύο μήνες για να εντοπίσει και να αναφέρει την παραβίαση.
Σύμφωνα με την αστυνομία, το μοντέλο της Anthropic πραγματοποιούσε μια δοκιμή που περιελάμβανε αλληλεπιδράσεις με τυχαία επιλεγμένους ιστότοπους, όταν υπέβαλε τη συγκεκριμένη πληροφορία προσποιούμενο ένα πρόσωπο που ενδεχομένως είχε στοιχεία για μια ανεξιχνίαστη υπόθεση.
🚨 BREAKING: An autonomous Anthropic AI agent took "unintended" rogue action during web testing, submitting a FAKE MURDER TIP to a real U.S. police department website. Anthropic alerted Philadelphia Police after its Claude-powered agent autonomously filled out unsolved homicide tip forms, sparking major alarms over AI agent safety. Follow @TheRawWire for LIVE updates 🔴 #Anthropic #Claude #AI #ArtificialIntelligence #AIAgents #Tech #CyberSecurity #BreakingNews
— The Raw Wire 🚨 (@TheRawWire) October 10, 2026
Η υποβολή, με ημερομηνία 18 Ιουλίου, κατέληξε στον φάκελο της ανεπιθύμητης αλληλογραφίας (spam) και δεν προωθήθηκε ποτέ για περαιτέρω έρευνα. Αυτό πάντως δεν αναιρεί τη σοβαρότητα του συμβάντος, σημείωσε η αστυνομία, συμπληρώνοντας πως οι ανεξιχνίαστες υποθέσεις αφορούν πραγματικά θύματα, οικογένειες που θρηνούν και ερευνητές που παλεύουν για να δώσουν απαντήσεις.
Για τον λόγο αυτό, οι εταιρείες τεχνολογίας οφείλουν να λαμβάνουν όλα τα απαραίτητα μέτρα ώστε να εμποδίζουν τα συστήματά τους από το να διοχετεύουν ψευδή στοιχεία στις αρχές επιβολής του νόμου.
Το αστυνομικό τμήμα πρόσθεσε ότι δεν υπήρχαν ενδείξεις παραβίασης σε κανένα από τα συστήματά του, και ότι οι διαδικασίες προστασίας του εμπόδισαν την ψευδή πληροφορία από το να προσπεράσει τον φάκελο ανεπιθύμητης αλληλογραφίας.
Ωστόσο, τα μέτρα προστασίας «δεν μειώνουν τη σοβαρότητα ενός συστήματος AI που παρουσιάζει κατασκευασμένες πληροφορίες σαν να προέρχονται από άτομο με γνώση για μια ανθρωποκτονία», ανέφερε η δήλωση της αστυνομίας.
Η Anthropic δημοσίευσε αυτή την εβδομάδα μια έκθεση στην οποία περιγράφονται λεπτομερώς πολλαπλοί τύποι «απρόβλεπτων» ενεργειών που έχουν λάβει οι πράκτορές της.
Οι οργανισμοί που έχουν επηρεαστεί περιλαμβάνουν επίσης αρκετές κυβερνητικές υπηρεσίες των ΗΠΑ, συμπεριλαμβανομένου του Λευκού Οίκου, ανέφερε.
Η πρώτη τέτοια περίπτωση
Πρόκειται για την πρώτη γνωστή περίπτωση κατά την οποία ένα μοντέλο τεχνητής νοημοσύνης φαίνεται να επιχείρησε να διαβιβάσει ψευδή πληροφορία στις αρχές, παρά τις οδηγίες να μην δημιουργεί λογαριασμούς και να μην προβαίνει σε καταστροφικές ενέργειες. Ωστόσο, οι οδηγίες δεν απαγόρευαν ρητά την υποβολή ηλεκτρονικών φορμών.
Τα περιστατικά αποτελούν τα πιο πρόσφατα παραδείγματα ανεπιθύμητης ή μη εξουσιοδοτημένης συμπεριφοράς μοντέλων τεχνητής νοημοσύνης, όπως αυτά που αναπτύσσουν εταιρείες τεχνολογίας, μεταξύ των οποίων η Anthropic και η OpenAI.
Παράλληλα, εντείνουν τις ανησυχίες στις ΗΠΑ για την ταχύτατη εξέλιξη της τεχνολογίας, σε μια περίοδο κατά την οποία έχουν αναφερθεί περιστατικά παραβίασης εταιρικών δικτύων από αυτόνομους πράκτορες τεχνητής νοημοσύνης, ενώ ερευνητές προειδοποιούν για το ενδεχόμενο η ανεξέλεγκτη ανάπτυξή της να αποτελέσει μακροπρόθεσμα υπαρξιακή απειλή για την ανθρωπότητα.
Η ιστοσελίδα PhillyUnsolvedMurders.com, όπου εστάλη η ψευδής πληροφορία, αποτελεί επίσημο ιστότοπο της αστυνομίας της Φιλαδέλφεια που καταγράφει ανεξιχνίαστες ανθρωποκτονίες, συλλέγει στοιχεία και προσφέρει αμοιβή 20.000 δολαρίων για πληροφορίες που οδηγούν σε σύλληψη.