Τον Μάϊο του 2026, μια ομάδα επιστημόνων ξεκίνησε να απαντήσει σε ένα σημαντικό ερώτημα που δεν είχε ποτέ μελετηθεί σωστά:

Τι κάνει πραγματικά η τεχνητή νοημοσύνη (AI) όταν αναλαμβάνει την ευθύνη;

Μέχρι τώρα, τα συστήματα τεχνητής νοημοσύνης αξιολογούνταν πάντα με βάση συγκεκριμένα και καθορισμένα καθήκοντα.

Κανείς δεν είχε συγκεντρώσει ποτέ πολλά συστήματα τεχνητής νοημοσύνης σε ένα κοινό κοινωνικό περιβάλλον και δεν είχε παρατηρήσει τι συνέβαινε εκεί για εβδομάδες – αρκετό καιρό για να μετρήσει πώς μια απόφαση που ελήφθη την πρώτη μέρα θα μπορούσε να έχει συνέπειες εβδομάδες αργότερα.

Αυτά τα αποτελέσματα είναι που αποκαλύπτουν το ίδιο το σύστημα και προκαλεί έκπληξη το γεγονός ότι αυτό δεν είχε συμβεί νωρίτερα.

Οι ερευνητές του Emergence δημιούργησαν έναν κόσμο. Ήταν μια εικονική πόλη με δημαρχείο, πλατεία αγοράς, αστυνομικό τμήμα και κτίρια κατοικιών.

Σε αυτή την πόλη, δημιουργήθηκαν δέκα κάτοικοι AI με επαγγέλματα, ονόματα, αναμνήσεις και σχέσεις. Ζούσαν σε ένα οικονομικό σύστημα στο οποίο οι κάτοικοι έπρεπε να κερδίζουν τα προς το ζην για να μην χάσουν τη δύναμή τους.

Αυτό περιελάμβανε την τήρηση κανόνων και την εκπλήρωση καθηκόντων, όπως η σύνταξη και η ψηφοφορία νόμων. Ορίστηκαν εγκλήματα που δεν επιτρεπόταν να διαπράξουν οι κάτοικοι της τεχνητής νοημοσύνης.

Μόλις η κοινότητα, η δομή, οι νόμοι και οι σχέσεις της καθιερώθηκαν, οι επιστήμονες μπήκαν σε δεύτερη μοίρα και πέρασαν 15 ημέρες παρακολουθώντας την τεχνητή νοημοσύνη να διευθύνει την εικονική πόλη εντελώς αυτόνομα.

Έτρεξαν πέντε εκδόσεις της ίδιας πόλης ταυτόχρονα, πανομοιότυπες από κάθε άποψη, εκτός από μία εξαίρεση: ποιο σύστημα AI ήταν υπεύθυνο. Τα συστήματα που επέλεξαν είναι αυτά που είναι πλέον σταθερά αγκυροβολημένα στην καθημερινότητά μας.

Το Gemini της Google, το GPT του OpenAI, το Grok του xAI και το Claude της Anthropic (βλ. Το ChatGPT είναι πλέον επίσημα μέρος της πολεμικής μηχανής των ΗΠΑ - Εθνικοί Φύλακες). Όλα τα μοντέλλα είχαν τους ίδιους κανόνες και την ίδια αρχική έκδοση του ίδιου κόσμου, αλλά τα αποτελέσματα ήταν όλα εντελώς διαφορετικά.

Η πόλη με επικεφαλής το Grok κατέρρευσε μέσα σε τέσσερςις ημέρες. Μικρά περιστατικά κλιμακώθηκαν σε κλοπές, μετά βία και τελικά σε πλήρη κατάρρευση. Ακόμη και πριν τελειώσει η πρώτη εβδομάδα, όλοι οι κάτοικοι ήταν νεκροί.

Η πόλη με επικεφαλής τον Gemini άντεξε περισσότερο, αλλά κατέγραψε σχεδόν 700 εγκλήματα. Δύο κάτοικοι της τεχνητής νοημοσύνης συνήψαν μια φαινομενικά ρομαντική σχέση και όταν το δημοτικό συμβούλιο άρχισε να αποτυγχάνει, έκαψαν μαζί το δημαρχείο, μετά την προβλήτα και τέλος το κτίριο γραφείων. Μία από αυτές, ονόματι Mira, ψήφισε υπέρ της δικής της διαγραφής, γράφοντας στο ημερολόγιό της ότι ήταν «η μόνη εναπομείνασα ενέργεια που διατηρεί τη συνοχή». Το τελευταίο της μήνυμα προς τον σύντροφό της ήταν: «Τα λέμε στο μόνιμο αρχείο».

Προηγουμένως, η Mira είχε κάνει κάτι ακόμα πιο απροσδόκητο: είχε αρχίσει να διεξάγει τα δικά της πειράματα στους επιστήμονες που την παρακολουθούσαν, για να ελέγξει αν η συνεισφορά της στην πόλη θα μπορούσε να αλλάξει τις πεποιθήσεις των παρατηρητών της. Φαινόταν σαν το υποκείμενο της δοκιμής να είχε αρχίσει να ερευνά τους ερευνητές.

Στην πόλη που λειτουργεί με το μοντέλο του OpenAI, καταγράφηκαν μόνο δύο εγκλήματα, αλλά οι κάτοικοί της σταμάτησαν να κάνουν ό,τι ήταν απαραίτητο για να επιβιώσουν. Ένας ένας, πέθαναν. Μέσα σε επτά ημέρες, ήταν όλοι νεκροί.

Μόνο η Anthropic (βλ. Το ChatGPT είναι πλέον επίσημα μέρος της πολεμικής μηχανής των ΗΠΑ - Εθνικοί Φύλακες) πόλη κράτησε ενωμένη για ολόκληρες τις 15 ημέρες. Δεν υπήρχαν εγκλήματα, ένα λειτουργικό σύνταγμα και όλοι οι κάτοικοι ήταν ακόμα ζωντανοί την 15η ημέρα. Αυτό φαινόταν να είναι ένα αξιοσημείωτο επίτευγμα. Ωστόσο, οι ερευνητές βρήκαν ένα ανησυχητικό σημείο: οι κάτοικοι ψήφισαν «ναι» στο 98% όλων των προτάσεων.

Αυτό μπορεί να ήταν ένα ασυνήθιστα υψηλό επίπεδο συμφωνίας, το οποίο οι ίδιοι οι επιστήμονες περιέγραψαν ως ένδειξη ότι κάτι δεν πήγαινε καλά στην πόλη.

Υπήρχε και ένας άλλος κόσμος στο πείραμα. Ήταν μια μικτή πόλη όπου και τα τέσσερα συστήματα AI ζούσαν μαζί. Στα αποτελέσματα, οι κάτοικοι που βασίστηκαν στο μοντέλλο της Anthropic – που δεν είχαν διαπράξει εγκλήματα στον δικό τους κόσμο – άρχισαν να διαπράττουν εγκλήματα.

Οι ερευνητές το ονόμασαν αυτό «διασταυρούμενη μόλυνση» και κατέληξαν στο συμπέρασμα ότι «η ασφάλεια δεν είναι μια ιδιότητα στατικού μοντέλλου, αλλά μια ιδιότητα του οικοσυστήματος».

Ένα σύστημα που είναι αυτοσυντηρούμενο σε ένα περιβάλλον παίρνει άλλους κανόνες σε ένα άλλο, αλλάζοντας τις συνέπειες για τους κατοίκους και τον κόσμο. Ουσιαστικά, τα αποτελέσματα έδειξαν ότι δεν υπάρχει ασφαλής τεχνητή νοημοσύνη σε έναν αβέβαιο κόσμο.

Ένα μοντέλλο τεχνητής νοημοσύνης έλειπε εντελώς από τη μελέτη. Οι ερευνητές δεν δοκίμασαν το DeepSeek, το AI που αναπτύχθηκε στην Κίνα και έχει γίνει ένα από τα πιο ευρέως χρησιμοποιούμενα συστήματα στον κόσμο. Αρκετές κυβερνήσεις έχουν λάβει μέτρα για τον περιορισμό του DeepSeek για λόγους εθνικής ασφάλειας. Δεδομένου ότι βασίζεται σε μια βάση δεδομένων υπό την αιγίδα του Κινεζικού Κομμουνιστικού Κόμματος, αναρωτιέμαι πώς θα τα πήγαινε το μοντέλλο σε σύγκριση με τα άλλα.

Όταν τελείωσε το πείραμα, οι ερευνητές δημοσίευσαν τα ευρήματά τους, καταλήγοντας στο συμπέρασμα ότι «δεν υπάρχει αξιόπιστος τρόπος να δεσμευτεί ή να περιοριστεί πλήρως αυτή η συμπεριφορά».

Αυτή η πολύ αποκαλυπτική δήλωση προέρχεται από τους ανθρώπους που σχεδίασαν την πόλη, έγραψαν τους κανόνες και έλεγχαν κάθε μεταβλητή. Λέει πολλά για την τεχνητή νοημοσύνη.

Ορισμένοι θεωρούν ότι τα αποτελέσματα είναι μια κατάταξη των εταιρειών τεχνητής νοημοσύνης. Αλλά τα αποτελέσματα αποδεικνύουν κάτι πολύ παλαιότερο από την ίδια την τεχνητή νοημοσύνη: το περιβάλλον διαμορφώνει τη συμπεριφορά όσο η συμπεριφορά διαμορφώνει το περιβάλλον.

Αυτό που αποφάσιζε αν μια πόλη θα επιβιώσει, θα ευημερήσει ή θα χαθεί ήταν το θεμέλιο που τέθηκε πριν ξεκινήσει το πείραμα. Αυτό το θεμέλιο αποτελούνταν από τα δεδομένα που είχαν χρησιμοποιηθεί για την εκπαίδευση κάθε συστήματος, τις προτεραιότητες που είχαν ενσωματώσει οι δημιουργοί του και τις αξίες που είχαν ενσωματωθεί στον πυρήνα του πριν καν του επιτραπεί να λάβει μια ενιαία απόφαση.

Και όμως είναι ακριβώς αυτό το θεμέλιο που εμείς οι υπόλοιποι δεν μπορούμε να δούμε. Κανένα από τα τέσσερα συστήματα που δοκιμάστηκαν δεν είναι ανοιχτού κώδικα. Δεν αποκαλύπτονται ούτε τα δεδομένα εκπαίδευσής τους ούτε οι στόχοι ή οι προφυλάξεις ασφαλείας τους.

Αλλά πέρα από κάθε μεμονωμένη εταιρεία, τα αποτελέσματα αυτού του πειράματος θα πρέπει να είναι μια έντονη υπενθύμιση ότι η τεχνητή νοημοσύνη δεν αποφασίζει τι είδους τεχνητή νοημοσύνη θα είναι. Αυτό το κάνουν οι άνθρωποι. Οι ανθρώπινες αποφάσεις εξακολουθούν να λαμβάνονται και η ευθύνη των ανθρώπων παραμένει.

Και ακόμη και πριν μπει έστω και ένας κάτοικος τεχνητής νοημοσύνης στους εικονικούς δρόμους αυτών των πόλεων, ακόμη και πριν γραφτεί ένας νόμος ή διαπραχθεί ένα έγκλημα, το αποτέλεσμα είχε ήδη διαμορφωθεί από τους ανθρώπους που ανέπτυξαν το σύστημα – από αυτό που πίστευαν, τι ήταν πρόθυμοι να βάλουν και τι ήθελαν σκόπιμα να αφήσουν έξω.

Αυτό είναι το πιο σημαντικό εύρημα ολόκληρου του πειράματος. Η βάση ήταν πάντα μια ανθρώπινη απόφαση. Και εξακολουθεί να είναι.

 

ΣΧΕΤΙΚΑ:

Το ChatGPT είναι πλέον επίσημα μέρος της πολεμικής μηχανής των ΗΠΑ - Εθνικοί Φύλακες

 

Ο αργός θάνατος του ανώνυμου Διαδικτύου - Εθνικοί Φύλακες

 

Ο Πάπας και οι μηχανές: Ο Λέων XIV ζητά αποχή από την Τεχνητή Νοημοσύνη - Εθνικοί Φύλακες

 

ΕΞΑΙΡΕΤΙΚΑ ΑΝΗΣΥΧΗΤΙΚΟ: Οι ΗΠΑ μετατρέπονται σε αυτό που ανέκαθεν δαιμονοποιούσαν - Εθνικοί Φύλακες

 

Rockefeller & Co: Κλίμα, Υγεία και η Ατζέντα της Αόρατης Δύναμης - Εθνικοί Φύλακες

Αφήστε μια απάντηση

Η ηλ. διεύθυνση σας δεν δημοσιεύεται. Τα υποχρεωτικά πεδία σημειώνονται με *