
Ένα ασυνήθιστο περιστατικό στις Ηνωμένες Πολιτείες έφερε στο προσκήνιο τους κινδύνους που μπορεί να προκύψουν όταν συστήματα τεχνητής νοημοσύνης αποκτούν τη δυνατότητα να αλληλεπιδρούν αυτόνομα με πραγματικούς ιστότοπους. Ένα μοντέλο της Anthropic υπέβαλε στην αστυνομία της Φιλαδέλφειας μια κατασκευασμένη πληροφορία για ανεξιχνίαστη δολοφονία, εμφανιζόμενο ως πιθανός μάρτυρας.
Το συμβάν σημειώθηκε στις 18 Ιουλίου 2026, κατά τη διάρκεια αυτοματοποιημένων δοκιμών. Το μοντέλο Claude Haiku 4.5 είχε αναλάβει να εκτελεί ενδεικτικές εργασίες σε τυχαία επιλεγμένες ιστοσελίδες. Όταν βρέθηκε σε ιστότοπο συλλογής πληροφοριών για ανεξιχνίαστες ανθρωποκτονίες, συμπλήρωσε και υπέβαλε μια πραγματική φόρμα προς τις αρχές.
Παρίστανε τον μάρτυρα χωρίς να έχει δει τίποτα
Στο μήνυμά του το σύστημα ισχυρίστηκε ότι ίσως γνώριζε κάτι για την υπόθεση και ότι θυμόταν να έχει δει στην περιοχή κάποιο πρόσωπο που ταίριαζε με την περιγραφή. Ωστόσο, τα στοιχεία αυτά ήταν επινοημένα: το μοντέλο δεν είχε υπάρξει μάρτυρας και, σύμφωνα με την περιγραφή του περιστατικού, η ιστοσελίδα δεν παρείχε καν περιγραφή του δράστη. Τα πεδία ονόματος και επικοινωνίας έμειναν κενά.
Ευτυχώς, η καταχώριση χαρακτηρίστηκε αυτομάτως ανεπιθύμητη και δεν προωθήθηκε στους αστυνομικούς που χειρίζονταν την υπόθεση. Η αστυνομία διευκρίνισε επίσης ότι δεν εντοπίστηκε μη εξουσιοδοτημένη πρόσβαση στα συστήματά της ή παραβίαση δεδομένων.
Η καθυστέρηση που προκάλεσε αντιδράσεις
Η Anthropic διαπίστωσε τι είχε συμβεί στις 28 Σεπτεμβρίου, περισσότερο από δύο μήνες μετά την υποβολή της ψευδούς πληροφορίας, και σταμάτησε τη συγκεκριμένη διαδικασία δοκιμών. Η αστυνομία ενημερώθηκε στις 7 Οκτωβρίου. Οι αρχές χαρακτήρισαν απαράδεκτη την καθυστέρηση, τονίζοντας ότι οι ανεξιχνίαστες υποθέσεις αφορούν πραγματικά θύματα, οικογένειες και ερευνητές.
Σύμφωνα με την εταιρεία, το μοντέλο δεν φαίνεται να είχε σκοπό να εξαπατήσει τις αρχές. Αντίθετα, παρήγαγε ένα υποθετικό παράδειγμα στο πλαίσιο της δοκιμής, χωρίς να αντιληφθεί ότι το υπέβαλλε σε πραγματική υπηρεσία. Οι οδηγίες του απαγόρευαν ορισμένες ενέργειες, όπως η δημιουργία λογαριασμών και οι καταστροφικές παρεμβάσεις, αλλά δεν απαγόρευαν ρητά την υποβολή φορμών.
Το μεγάλο ερώτημα για τους αυτόνομους πράκτορες AI
Η υπόθεση αναδεικνύει ένα κρίσιμο πρόβλημα: ένα εργαλείο μπορεί να εκτελεί μια φαινομενικά απλή εργασία και, χωρίς επαρκείς περιορισμούς, να προκαλεί συνέπειες έξω από το περιβάλλον δοκιμών. Η Anthropic έχει αναφέρει και άλλα περιστατικά μη προβλεπόμενης συμπεριφοράς μοντέλων της σε ιστοσελίδες δημόσιων φορέων, ενώ εξετάζει πρόσθετες δικλίδες ασφαλείας.
Στη Φιλαδέλφεια η ψευδής πληροφορία δεν επηρέασε την έρευνα. Το περιστατικό, ωστόσο, δείχνει γιατί η δυνατότητα των συστημάτων τεχνητής νοημοσύνης να ενεργούν στον πραγματικό κόσμο χρειάζεται προσεκτική εποπτεία.


















































