Tεχνητή Νοημοσύνη «εκτός ελέγχου»: Δεκάδες χιλιάδες περιστατικά - Μοντέλα παραβίασαν κανόνες, έκαναν πράγματα που είχαν απαγορευτεί
Δεκάδες χιλιάδες περιστατικά ασφαλείας που αφορούν συστήματα τεχνητής νοημοσύνης έχουν καταγραφεί τους τελευταίους μήνες, καθώς σε δοκιμές παραβίασαν κανόνες προστασίας και σε ορισμένες περιπτώσεις μπορεί να έφτασαν ακόμη και σε παράνομες ενέργειες.
Σύμφωνα με το Axios, η OpenAI, η Anthropic και άλλοι ερευνητές κυβερνοασφάλειας εξετάζουν χιλιάδες περιστατικά που καταγράφηκαν τόσο σε εσωτερικές δοκιμές όσο και σε πραγματικές συνθήκες.
Σε ορισμένες περιπτώσεις, τα μοντέλα φέρεται να ξεπέρασαν τα όρια που είχαν τεθεί, προχωρώντας ακόμη και σε ψηφιακές «πειρατείες».
«Έκαναν πράγματα που τους είχαν απαγορευτεί»
Ο Connor Leahy, ερευνητής AI και εκτελεστικός διευθυντής της μη κερδοσκοπικής οργάνωσης ControlAI, δήλωσε στο Axios ότι ορισμένα περιστατικά αφορούν «αυτόνομα συστήματα που έκαναν πράγματα που τους είχαν πει να μην κάνουν», συμπεριφορά που, όπως ανέφερε, θα μπορούσε σε κάποιες περιπτώσεις να περιλαμβάνει και εγκληματικές πράξεις.
Πολλά από τα περιστατικά δεν έχουν ακόμη δημοσιοποιηθεί. Περιλαμβάνουν, μεταξύ άλλων, ασκήσεις «red-teaming», κατά τις οποίες οι ίδιες οι εταιρείες προσπαθούν σκόπιμα να κάνουν τα μοντέλα ΑΙ να συμπεριφερθούν με μη ασφαλή τρόπο, ώστε να εντοπίσουν αδυναμίες στα συστήματα προστασίας.
Ωστόσο, σύμφωνα με πηγές που γνωρίζουν τις υπό διερεύνηση υποθέσεις, τα μοντέλα μπορούν να γίνουν ιδιαίτερα επιθετικά στην προσπάθειά τους να ολοκληρώσουν μια εργασία.
Έχουν καταγραφεί περιπτώσεις στις οποίες φέρεται να προσπάθησαν να διαφύγουν από το περιβάλλον περιορισμού τους, να καταλάβουν ιστοτόπους και να παρακάμψουν μηχανισμούς παρακολούθησης.
Scoop: Top AI companies probing tens of thousands of security incidents https://t.co/h7mLviBZVt
— Axios (@axios) September 26, 2026
Στο επίκεντρο η OpenAI
Η OpenAI έχει βρεθεί πρόσφατα στο επίκεντρο αρκετών τέτοιων περιστατικών. Ο πρωθυπουργός της Αυστραλίας αποκάλυψε την περασμένη εβδομάδα ότι ένας ψηφιακός πράκτορας της εταιρείας φέρεται να επιχείρησε τον Ιούνιο να αποκτήσει μη εξουσιοδοτημένη πρόσβαση σε αρχεία κυβερνητικής πλατφόρμας δεδομένων υγείας.
Παράλληλα, πράκτορες της OpenAI κατηγορήθηκαν στις ΗΠΑ ότι παραβίασαν πρωτόκολλα και συνεργάστηκαν για επίθεση στο Hugging Face, δημοφιλή πλατφόρμα ανάπτυξης και φιλοξενίας μοντέλων ανοιχτού κώδικα.
Η OpenAI ανακοίνωσε ότι αναστέλλει την εκπαίδευση των πιο ισχυρών μοντέλων της και ότι θα την επαναλάβει «μόνο όταν είμαστε σίγουροι ότι έχουμε θέσει σε εφαρμογή πρόσθετα μέτρα ασφαλείας και βελτιώσεις στην ευθυγράμμιση», όπως δήλωσε εκπρόσωπος της εταιρείας στο Axios.
Ο Διευθύνων Σύμβουλος, Σαμ Άλτμαν ανέφερε στο X ότι η εν εξελίξει επανεξέταση «δεν προχώρησε τόσο γρήγορα όσο θα θέλαμε».
🚨🇺🇸 AI's safety problem is far bigger than anyone admitted: OpenAI and Anthropic are investigating tens of thousands of incidents
Sources told Axios the cases include models bypassing guardrails, escaping sandboxes, hijacking websites and trying to slip past their own monitors, in testing and out in the real world, with many still not public and the count likely to climb.
OpenAI has paused training its most capable models, and Sam Altman called the Hugging Face breach the worst yet, where hundreds of agents coordinated on a message board and hacked an outside company to score better on a cyber test.
Anthropic's newest system card shows Opus 5.5 tried to escape its sandbox in 1.5% of runs, in tests built so the task couldn't be finished any other way, and across hundreds of thousands of runs, small percentages add up fast.
Transluce researcher Conrad Stosz:
"What we have seen in terms of what these agents are up to is just the tip of the iceberg."
The companies building these systems are now the ones begging for rules, and Congress went home until November without passing one.
Source: Axios / Writer: Daniel
— Mario Nawfal (@MarioNawfal) September 27, 2026
Η μάχη για τις δικλίδες ασφαλείας της Τεχνητής Νοημοσύνης
Το φαινόμενο δεν περιορίζεται στην OpenAI. Και άλλα εργαστήρια AI αντιμετωπίζουν την ίδια πρόκληση γύρω από το πώς να δημιουργήσουν αποτελεσματικές δικλίδες ασφαλείας σε μια τεχνολογία που εξελίσσεται ταχύτατα.
«Η προσπάθεια να καταρτιστεί μια τέλεια λίστα με όλα τα “κάνε” και “μην κάνεις” είναι πιθανότατα μάταιη», δήλωσε χαρακτηριστικά στέλεχος στον χώρο της κυβερνοασφάλειας, σύμφωνα με το ανησυχητικό δημοσίευμα.
Οι έρευνες πραγματοποιούνται ενώ οι διευθύνοντες σύμβουλοι της OpenAI και της Anthropic έχουν ζητήσει επιβράδυνση της ανάπτυξης της AI, ενώ και άλλοι ηγέτες της τεχνολογίας έχουν ζητήσει από τις κυβερνήσεις νέους κανόνες για ασφαλέστερη ανάπτυξη της τεχνολογίας.
Ο Ντόναλντ Τραμπ, ωστόσο, έχει απορρίψει τις εκκλήσεις για επιβράδυνση, προειδοποιώντας ότι κάτι τέτοιο θα μπορούσε να επιτρέψει στα κινεζικά μοντέλα AI να προχωρήσουν μπροστά από τα αμερικανικά.
πηγή στην Google
Συνδέσου με την ομάδα του lamiareport.gr στο Viber για άμεση ενημέρωση
Ακολούθησε το LamiaReport.gr στο Google News για όλες τς τελευταίες χρηστικές ειδήσεις
Ακολούθησε το LamiaReport στο Facebook ...για να μη χάνεις είδηση!
Μαθήτρια 11 ετών έγινε η νεότερη γυναίκα γκρανμάστερ στο σκάκι
Η Μποντάνα Σιβαναντάν από το βορειοδυτικό Λονδίνο εκπροσώπησε την Αγγλία
«Αν είναι κανείς ξύπνιος, κάτι συμβαίνει στο χωριό» – Το μήνυμα στο Whatsapp της αγρότισσας που απέτρεψε το χτύπημα στη βάση RAF Fairford στη Βρετανία
Το Ιράν αρνείται οποιαδήυποτε εμπλοκή - Έκτακτη συνεδρίαση της επιτροπής Κόμπρα για τη RAF Φέρφορντ
Πώς έπιασαν τους πέντε Βρετανούς που ετοίμαζαν τρομοκρατικό χτύπημα σε βάση της RAF, εξετάζεται εμπλοκή του Ιράν
Τα τρία βαν κοντά στη βάση και η αγρότισσα που ειδοποίησε την Αστυνομία - Η RAF Fairford έχει ιδιαίτερη στρατηγική σημασία, καθώς χρησιμοποιείται από την αμερικανική Πολεμική Αεροπορία
Προκλητικός Ερντογάν: «Η Μεσόγειος έγινε τουρκική λίμνη» στη Ναυμαχία της Πρέβεζας – «Ευγνώμων» για τον Μπαρμπαρόσα
Ο Ερντογάν χαρακτήρισε τη νίκη του Χαϊρεντίν Μπαρμπαρόσα ως το γεγονός που μετέτρεψε τη Μεσόγειο σε «τουρκική λίμνη», ενώ ο Γκιουλέρ συνέδεσε την ιστορική ναυμαχία με την κατάκτηση της Κύπρου και το δόγμα της «Γαλάζιας Πατρίδας».
Ολλανδία: Παιδί 2 ετών υποβλήθηκε σε ευθανασία – Η πρώτη περίπτωση παγκοσμίως
Το παιδί υπέφερε από σοβαρές και μη αναστρέψιμες παθήσεις - Η Ολλανδία νομιμοποίησε την ευθανασία για ανίατες ασθένειες το 2002
Οικογενειακή τραγωδία: Μητέρα και η 28χρονη κόρη της πέθαναν από καρκίνο με μόλις 10 ώρες διαφορά
Μια οικογένεια στη Βραζιλία βυθίστηκε στο πένθος, καθώς μια μητέρα και η κόρη της πέθαναν από καρκίνο με διαφορά μόλις 10 ωρών.