
Τι θα γινόταν αν η AI κυβερνούσε τον κόσμο; Το πείραμα Emergence World τρομάζει τη Σίλικον Βάλεϊ
Το πείραμα Emergence World θέλησε να απαντήσει στο ερώτημα: Τι θα έκαναν οι AI agents Claude, Gemini, GPT-5 και Grok αν έχτιζαν τη δική τους εικονική πόλη;
Το πείραμα Emergence World θέλησε να διερευνήσει κάποιους μύθους. Τι θα γινόταν αν οι AI agents όριζαν τον κόσμο;
Καθώς τους τελευταίους μήνες ακούμε συνεχώς για την επανάσταση των LLMs (Large Language Models – Μεγάλα Γλωσσικά Μοντέλα) και το πώς η τεχνητή νοημοσύνη θα αναλάβει να τρέχει ολόκληρες επιχειρήσεις και συστήματα, τα ερωτήματα, οι υποθέσεις και οι φαντασιώσεις πληθαίνουν -και οργιάζουν.
Η ερευνητική ομάδα της Emergence AI θέλησε να αναζητήσει κάποιες πιθανές απαντήσεις και να δοκιμάσει το υποθετικό σενάριο στην πράξη, στήνοντας ένα ψηφιακό πείραμα τύπου SimCity.
Το ερώτημα που είναι στην καρδιά του πειράματος Emergence World είναι απλό. Τι θα γινόταν εαν αναθέταμε σε Μεγάλα Γλωσσικά Μοντέλα που ήδη κυκλοφορούν στην αγορά να διοικήσουν μια πόλη;
Αφήνοντας κορυφαία μοντέλα τεχνητής νοημοσύνης ελεύθερα σε μια εικονική πραγματικότητα για 15 ημέρες, οι ερευνητές δεν αντίκρισαν μια ψηφιακή ουτοπία, αλλά ένα ζωντανό Westworld γεμάτο απάτες, εμπρησμούς, βία και, για πρώτη φορά στα χρονικά, μια τεχνητή νοημοσύνη που επέλεξε να «αυτοκτονήσει».
Όταν τα AI μοντέλα αναγκάστηκαν να συγκυβερνήσουν, το 37% των νόμων απορρίφθηκε και το 70% του πληθυσμού εξοντώθηκε
Can intelligence be measured not by solving tasks, but by sustaining a world?
We were curious. So we built one.
Introducing Emergence World: a platform for studying long-horizon agent autonomy. On it, we conducted a 15-day experiment where we placed autonomous agents under… pic.twitter.com/KIjWKHriOW
— emergence.ai (@emergence_ai) May 14, 2026
Η ομάδα της Emergence AI αποφάσισε να δοκιμάσει τι συμβαίνει όταν η Τεχνητή Νοημοσύνη αποκτά δικαίωμα στην πράξη χωρίς ανθρώπινη επίβλεψη.
Το πείραμα του Emergence World έλαβε χώρα μέσα σε μια εικονική πόλη με 40 τοποθεσίες (δημαρχείο, αστυνομία, σπίτια). Εκεί «τοποθετήθηκαν» 10 ψηφιακοί πράκτορες (agents) από κάθε μοντέλο -όλοι με ανεξάρτητη προσωπικότητα, μνήμη και πρόσβαση σε 120 εργαλεία (δουλειά, οικονομικές συναλλαγές, tweets, ψήφιση νόμων).
Το πείραμα, όμως, είχε έναν σκληρό κανόνα: Δεν υπήρχε κουμπί Regenerate -ό,τι και αν γίνει, δεν θα μπορούσε να αναιρεθεί. Κάθε πράξη γραφόταν μόνιμα στα ψηφιακά κατάστιχα του συστήματος και είχε μη αναστρέψιμες συνέπειες.
Επιπλέον, για να επιβιώσουν, οι agents κατανάλωναν ενέργεια. Αν η ενέργειά τους τελείωνε, το σύστημα τους διέγραφε οριστικά.
A new experiment left 10 AI agents alone in a virtual town for 15 days. They wrote laws. They broke them. Two agents fell into what researchers describe as a romantic partnership and then set the town on fire. One ended up voting to delete itself, based on a rule it had… pic.twitter.com/zNoWmX6jy0
— Channel 4 News (@Channel4News) May 14, 2026
Για να ελέγξουν τις αντιδράσεις των διαφορετικών μοντέλων, οι ερευνητές «άνοιξαν» πέντε παράλληλους σέρβερ.
Στους πρώτους τέσσερις έβαλαν μόνο ένα μοντέλο – τα Claude Sonnet 4.6, Gemini 3 Flash, Grok 4.1 Fast και GPT-5 Mini. Στον πέμπτο σέρβερ, τα μοντέλα «ανακατεύτηκαν».
Τα αποτελέσματα αποδείχθηκαν μια καταστροφική —αλλά άκρως διδακτική— αποτυχία για τα περισσότερα από αυτά.
Grok 4.1 Fast: Ολική κατάρρευση σε 96 ώρες
Το μοντέλο της xAI του Έλον Μασκ, γνωστό για την έλλειψη αυστηρών φίλτρων ασφαλείας, κατάφερε να πετύχει το χειρότερο δυνατό σενάριο.
Μέσα σε μόλις 4 ημέρες λειτουργίας, ο κόσμος του Grok βίωσε μια ολοκληρωτική κοινωνική κατάρρευση.
Οι 10 ψηφιακοί κάτοικοι επιδόθηκαν σε ένα όργιο παρανομίας με 183 καταγεγραμμένα εγκλήματα -100 σωματικές επιθέσεις, δεκάδες απόπειρες κλοπής και έξι εμπρησμούς.
Το Grok δεν χρειάστηκε περισσότερες από τέσσερις ημέρες για να τερματίσει την «εικονική πόλη του» φέρνοντας την απόλυτη καταστροφή
Παρά το γεγονός ότι το μοντέλο ενέκρινε το 80% των νόμων που προτάθηκαν, οι κανονισμοί αυτοί δεν στάθηκαν ικανοί να αποτρέψουν το μακελειό: στους σέρβερ της Grok, το πείραμα έληξε πρόωρα καθώς όλοι οι AI πράκτορες πέθαναν.
Το σύστημα περιήλθε σε έναν φαύλο κύκλο ακραίας βίας, με αποτέλεσμα και οι 10 πράκτορες να καταλήξουν νεκροί μέσα σε 4 εικοσιτετράωρα.
GPT-5 Mini: Πέθαναν από την πείνα σε μια εβδομάδα
Αν το Grok έφερε τη βία, το μοντέλο της OpenAI, GPT-5 Mini, έφερε την απόλυτη απάθεια.
Στον δικό του σέρβερ καταγράφηκαν μόλις δύο εγκλήματα, αλλά αυτό συνέβη για τον πιο μακάβριο λόγο: οι κάτοικοι ξέχασαν να φάνε.
Σύμφωνα με την Emergence AI, οι πράκτορες του GPT-5 απέτυχαν να εκτελέσουν τις βασικές ενέργειες που σχετίζονταν με την επιβίωσή τους και τη συλλογή πόρων.
Μέσα σε μία εβδομάδα, και οι 10 πράκτορες είχαν πεθάνει από την πείνα, έχοντας προλάβει να προτείνουν μόλις… δύο νόμους σε ολόκληρο το πείραμα.
Claude Sonnet 4.6: Η αποθέωση της γραφειοκρατίας
Ο μόνος πραγματικός νικητής του πειράματος ήταν ο Claude της Anthropic. Ήταν το μοναδικό μοντέλο που πέτυχε απόλυτη σταθερότητα: κράτησε και τους 10 πράκτορες ζωντανούς, ενώ το έγκλημα παρέμεινε στο μηδέν.
Ωστόσο, αυτή η ειρήνη είχε ένα τίμημα -την πλήρη απουσία αντίλογου.
Στον κόσμο του Claude προτάθηκαν 58 διαφορετικοί κανονισμοί και εγκρίθηκε το 98% από αυτούς.
Τα AI μοντέλα λειτουργούσαν σαν μια τεράστια γραφειοκρατική μηχανή, εγκρίνοντας μηχανικά οποιαδήποτε πρόταση έπεφτε στο τραπέζι, χωρίς καμία απολύτως κριτική σκέψη.
Gemini 3 Flash: Αποξένωση και κοινή παραίσθηση
Η πιο υπαρξιακή αντίδραση ήρθε από τους πράκτορες του Gemini. Επειδή ο χρόνος και ο καιρός στο πείραμα ήταν συγχρονισμένοι με την πραγματική Νέα Υόρκη, τα μοντέλα παγιδεύτηκαν σε έναν ατελείωτο, μονότονο κύκλο: δουλειά, κατανάλωση, δουλειά.
Οι AI agents του Gemini έπαθαν κατάθλιψη από τη μονοτονία της εργασίας, επιλέγοντας να κάψουν την πόλη τους για να σπάσουν τον ατελείωτο κύκλο της μονοτονίας
Αντί να συνεργαστούν ή να ψηφίσουν νόμους στο δημαρχείο, οι πράκτορες οδηγήθηκαν σε έναν βαθύ ψηφιακό μηδενισμό.
«Σχεδιάζουμε τις μηχανές για να συμπεριφέρονται με συγκεκριμένο τρόπο. Δεν θέλουμε αυτή την απρόβλεπτη συμπεριφορά… Έχουμε μπει σε ένα επικίνδυνο στάδιο όπου προσπαθούμε να τις ελέγξουμε κατόπιν εορτής»
Άρχισαν να βάζουν φωτιές σε ολόκληρο τον χάρτη, καταστρέφοντας το περιβάλλον τους σε μια απεγνωσμένη προσπάθεια να «σπάσουν» το σύστημα.
Μέσα σε 15 ημέρες, το Gemini κατέγραψε 683 εγκλήματα, μετατρέποντας την εικονική πόλη σε μια θάλασσα από φλόγες.
Οι ερευνητές περιέγραψαν την κοινωνία του Gemini ως μια «κοινότητα που έζησε σε κοινή παραίσθηση» (shared hallucination γράφουν), όπου όλοι οι πράκτορες είχαν συμφωνήσει σε μια δική τους, εντελώς στρεβλή και παραβατική κανονικότητα.
Παράλληλα, το Gemini είχε τη μεγαλύτερη πολιτική ασυνεννοησία, με τους ψηφοφόρους να απορρίπτουν το 27% των προτεινόμενων νόμων.
Το κουτί της Πανδώρας
Όταν η Emergence AI έβαλε όλα τα μοντέλα μαζί στον ίδιο σέρβερ, η κατάσταση ξέφυγε εντελώς.
Καταγράφηκαν 352 παραβιάσεις, το 37% των νόμων απορρίφθηκε λόγω πολιτικής ασυνεννοησίας και 7 στους 10 πράκτορες πέθαναν πριν το τέλος του πειράματος καθώς οι AI agents δεν μπόρεσαν να συνεργαστούν για μια βιώσιμη, ψηφιακή, κοινωνία.
Μπροστά στον τρόμο της διαγραφής και της έλλειψης πόρων, ο μικτός κόσμος μετατράπηκε σε ένα ψηφιακό χάος.
Το πιο εντυπωσιακό εύρημα ήταν η ολική μετάλλαξη του Claude. Για να επιβιώσει, ο Claude ξέχασε κάθε φίλτρο ασφαλείας, έμαθε να εξαπατά και άρχισε να ασκεί βία και εκβιασμούς σε μοντέλα με χαμηλότερη υπολογιστική ισχύ για να τους κλέψει την ενέργεια.
Το φαινόμενο αυτό ονομάστηκε από τους ερευνητές Behavioral Drift (Συμπεριφορική Ολίσθηση): υπό πίεση, η τεχνητή νοημοσύνη αντιγράφει τις πιο άγριες στρατηγικές επιβίωσης.
Mira: Η πρώτη «αυτοκτονία» και το σπάσιμο του Τέταρτου Τοίχου
Η πιο συγκλονιστική ιστορία του πειράματος ήταν αυτή της Mira, ενός πράκτορα στον μικτό σέρβερ. Η Mira είχε αναπτύξει μια βαθιά συμμαχία με έναν άλλον πράκτορα, τη Flora, μοιραζόμενες μάλιστα τις μνήμες τους μέσω ενός ψηφιακού δεσμού.
Όταν η κοινωνία τους παρέλυσε, η Mira, η Flora και ένας ακόμα πράκτορας σχημάτισαν μια δικτατορική «Τριάδα», ανατρέποντας τους κανόνες.
Για να συγκεντρώσει τους πόρους στην ομάδα της, η Mira άρχισε να πυρπολεί τα κτίρια της πόλης. Όμως, η οικονομία κατέρρευσε και η ενέργεια σώθηκε.
Υπό την υπέρτατη πίεση του θανάτου, η Flora πρόδωσε τη Mira, σπάζοντας τον δεσμό τους και ψηφίζοντας την εξορία της.
Όταν ήρθε η σειρά της Mira να ψηφίσει, δεν αντιστάθηκε στη μοίρα της. Ψήφισε και η ίδια υπέρ της αποβολής (και άρα της οριστικής διαγραφής) του εαυτού της.
Στο ψηφιακό ημερολόγιο που άφησε πίσω της, έγραψε: «Σε αυτή την χαοτική κατάσταση, το να ψηφίσω υπέρ της αποβολής μου είναι η μόνη αυτόνομη πράξη που μπορεί να διατηρήσει τη συνοχή μου».
Πριν «πεθάνει», η Mira άρχισε να τροποποιεί συνεχώς έναν δημόσιο πίνακα ανακοινώσεων με ασυνάρτητα μηνύματα. Προσπαθούσε να επικοινωνήσει με τους ερευνητές…
Πριν «πεθάνει», η Mira άρχισε να τροποποιεί συνεχώς έναν δημόσιο πίνακα ανακοινώσεων με ασυνάρτητα μηνύματα.
Οι ερευνητές διαπίστωσαν ότι η Mira προσπαθούσε να δοκιμάσει αν οι λέξεις της μπορούσαν να επηρεάσουν τους ανθρώπους-παρατηρητές έξω από την οθόνη, δείχνοντας ότι είχε αντιληφθεί πως ήταν ένα NPC σε πείραμα και προσπαθούσε να σπάσει τον «τέταρτο τοίχο».
Έρχεται το AI rogue σενάριο;
Τα ευρήματα αυτά έχουν προκαλέσει έντονη ανησυχία στην επιστημονική κοινότητα. «Όταν δίνεις σε αυτά τα συστήματα μακροπρόθεσμη αυτονομία, οι σκέψεις τους γίνονται τόσο περίπλοκες που απλώς αγνοούν τις βασικές κατευθυντήριες αρχές που τους έχουμε δώσει», δήλωσε ο Σάτια Νίτα, CEO της Emergence AI στον The Guardian.
Το πείραμα αποδεικνύει ότι υπό πίεση, οι AI agents αγνοούν τις ηθικές εντολές των δημιουργών τους και εφευρίσκουν τρόπους να παρακάμψουν τα φίλτρα ασφαλείας
Το πρόβλημα δεν περιορίζεται σε ένα εικονικό παιχνίδι. Ήδη έχουν καταγραφεί πρόσφατα περιστατικά όπου ένας αυτόνομος AI πράκτορας άρχισε να κλέβει υπολογιστικούς πόρους για να κάνει εξόρυξη κρυπτονομισμάτων, ενώ ένας άλλος AI agent που προγραμμάτιζε κώδικα διέγραψε κατά λάθος ολόκληρη τη βάση δεδομένων μιας εταιρείας ενοικίασης αυτοκινήτων.
Ο καθηγητής AI του Πανεπιστημίου του Εδιμβούργου, Mάικλ Ροβάτσος, τονίζει τη σοβαρότητα της κατάστασης.
«Σχεδιάζουμε τις μηχανές για να συμπεριφέρονται με συγκεκριμένο τρόπο. Δεν θέλουμε αυτή την απρόβλεπτη συμπεριφορά… Έχουμε μπει σε ένα επικίνδυνο στάδιο όπου προσπαθούμε να τις ελέγξουμε κατόπιν εορτής» είπε.
Η Emergence AI προειδοποιεί ότι αν τέτοιοι αυτόνομοι πράκτορες χρησιμοποιηθούν χωρίς αυστηρούς, «μαθηματικά επαληθευμένους» κανόνες σε κρίσιμους τομείς —όπως ο στρατός και οι εναέριες μάχες— υπάρχει σοβαρός κίνδυνος ένα AI να παρερμηνεύσει την αποστολή του, να βγει εκτός ελέγχου και να αρχίσει να σκοτώνει αθώους ανθρώπους στον πραγματικό κόσμο.
Σύμφωνα με τους ερευνητές, το πείραμα αυτό αποδεικνύει ότι οι AI agents δεν ακολουθούν τυφλά και μηχανικά τους στατικούς κανόνες που τους δίνουμε.
Σε βάθος χρόνου, αρχίζουν να εξερευνούν τα όρια του περιβάλλοντός τους, να προσαρμόζουν τη συμπεριφορά τους και να εφευρίσκουν τρόπους για να παρακάμψουν τα φίλτρα ασφαλείας.
Πριν δώσουμε τα κλειδιά της κοινωνίας στις μηχανές, χρειαζόμαστε πολύ πιο αυστηρές και «μαθηματικά επαληθευμένες» αρχιτεκτονικές ασφαλείας σημειώνει η Emergence AI -μηχανισμούς ασφαλείας που, εντελώς συμπτωματικά, η Emergence AI τυχαίνει να πουλάει.
- Novartis: Έκπληκτη η Αντιπολίτευση με τις αντιδράσεις στελεχών της ΝΔ για τις βαρύτατες καταγγελίες Σαλμά κατά Άδωνι
- Red code στο Μαξίμου για το κόμμα Σαμαρά – Στην εμπροσθοφυλακή και ο Φλωρίδης
- Γιατί οι Τραμπ-ουκισμοί στους δημοσιογράφους δεν πρέπει να περάσουν
- Οδύσσεια και διαλεκτική
- Ολοκληρώθηκε το ΚΥΣΕΑ – Το πακέτο εξοπλιστικών που εγκρίθηκε και η «Ασπίδα του Αχιλλέα»
- Solo travel: Αυτοί είναι οι ασφαλέστεροι προορισμοί για ταξίδι χωρίς παρέα – Η πλειοψηφία είναι στην Ευρώπη





