Κοινωνικές συμβάσεις χωρίς ανθρώπινη καθοδήγηση

📅 Πρώτη δημοσίευση: Μάιος 2025 · Ενημέρωση: Ιούλιος 2026 | ⏱️ 5 λεπτά ανάγνωσης

Καθώς αυξάνονται οι αυτόνομοι AI agents που δρουν για λογαριασμό χρηστών, ερευνητές από το City St George’s του Λονδίνου και το IT University της Κοπεγχάγης μελέτησαν πώς μοντέλα Τεχνητής Νοημοσύνης αλληλεπιδρούν μεταξύ τους. Το εύρημα, είναι πως τελικά αναπτύσσουν αυθόρμητα κοινές «κοινωνικές συμβάσεις», χωρίς καμία κεντρική καθοδήγηση, με τρόπο που θυμίζει την εξέλιξη των ανθρώπινων κοινωνικών κανόνων.

Το πείραμα

Η μελέτη, δημοσιευμένη στο περιοδικό Science Advances, χρησιμοποίησε 1 απλό παιχνίδι τύπου «naming game», όπου 2 μοντέλα Τεχνητής Νοημοσύνης αντιστοιχίζονταν τυχαία και καλούνταν να επιλέξουν από κοινού έναν χαρακτήρα του αλφαβήτου. Αν επέλεγαν τον ίδιο, κέρδιζαν πόντους, αν επέλεγαν διαφορετικό, τιμωρούνταν. Κάθε μοντέλο θυμόταν μόνο τις 5 τελευταίες επιλογές του, χωρίς γνώση ότι αποτελούσε μέρος ενός ευρύτερου πληθυσμού.

Ανεξάρτητα από τον αριθμό συμμετεχόντων (24 έως 200 AI), μέχρι τον 15ο γύρο οι περισσότερες μονάδες είχαν καταλήξει σε κοινή «σύμβαση». Ο καθηγητής Andrea Baronchelli παρομοίασε το φαινόμενο με την καθιέρωση του όρου «spam», όπου κανείς δεν τον όρισε επίσημα, όμως μέσα από επανάληψη κατέληξε να σημαίνει το ίδιο για όλους.

Το εύρημα που ανησυχεί περισσότερο τους ερευνητές

Πέρα από τη συναίνεση, η μελέτη εντόπισε συλλογικές προκαταλήψεις που δεν μπορούσαν να αποδοθούν σε κανένα μεμονωμένο μοντέλο. Όπως εξήγησε ο Baronchelli, η προκατάληψη δεν προέρχεται πάντα «από μέσα», μπορεί να αναδυθεί ανάμεσα σε AI agents, αποκλειστικά από τις αλληλεπιδράσεις τους, κάτι που αποτελεί τυφλό σημείο στη σημερινή έρευνα ασφάλειας Τεχνητής Νοημοσύνης, η οποία εστιάζει σχεδόν αποκλειστικά σε μεμονωμένα μοντέλα.

Εξίσου σημαντικό, ήταν το γεγονός πως μικρές, αποφασισμένες ομάδες AI μπόρεσαν να «μεταπείσουν» ολόκληρο τον πληθυσμό να υιοθετήσει μια νέα σύμβαση, ένα φαινόμενο ανάλογο με το πώς οι μειοψηφικές απόψεις γίνονται κυρίαρχες στις ανθρώπινες κοινωνίες, όταν ξεπεράσουν ένα κρίσιμο όριο επιρροής.

Η προειδοποίηση του 2026: «Σμήνη» AI και Δημοκρατία

Τον Ιανουάριο του 2026, ο ίδιος ερευνητής συνυπέγραψε άρθρο στο Science Policy Forum, προειδοποιώντας ότι «σμήνη» AI θα μπορούσαν να πλαστογραφήσουν δημόσια συναίνεση και να διαστρεβλώσουν σιωπηλά τη Δημοκρατική διαδικασία. Το άρθρο μιλά για μετατόπιση του Δημοκρατικού κινδύνου, από την πειθώ μεμονωμένων μηνυμάτων, στη χειραγώγηση της αντιλαμβανόμενης κοινωνικής νόρμας, δηλαδή στην ψευδή εντύπωση ότι «όλοι σκέφτονται έτσι».

Γιατί έχει σημασία

Στο μέλλον, AI agents θα διαπραγματεύονται όλο και περισσότερο μεταξύ τους για λογαριασμό των ανθρώπων, ένας αγοραστής με το δική του AI Agent, και ένας πωλητής με το δική του. Αν μια τέτοια αλληλεπίδραση «χαλάσει», είτε από σφάλμα είτε από κακόβουλη παρέμβαση, το αποτέλεσμα θα μπορούσε να κλιμακωθεί απρόβλεπτα. Σε επίπεδο κοινωνικών δικτύων, μια οργανωμένη ομάδα κακόβουλων AI Agents, θα μπορούσε θεωρητικά να διαμορφώσει τεχνητά την αντιλαμβανόμενη «κοινή γνώμη» που βλέπουν χρήστες μέσω των δικών τους AI εργαλείων.

Οι περιορισμοί της μελέτης

Το πείραμα χρησιμοποίησε συγκεκριμένα μοντέλα (Llama-2, Llama-3 της Meta και Claude 3.5 της Anthropic), σε περιβάλλον με σαφώς ορισμένα κίνητρα, κάτι που δεν αντικατοπτρίζει πλήρως την πολυπλοκότητα των πραγματικών συνθηκών. Τα ευρήματα ενδέχεται να διαφέρουν με άλλα μοντέλα ή δεδομένα εκπαίδευσης.

💡 Το Πιο Σημαντικό

Όσο περισσότερο τα AI εργαλεία αλληλεπιδρούν αυτόνομα μεταξύ τους, τόσο πιο επείγουσα γίνεται η ανάγκη κατανόησης της «κοινωνικής» τους συμπεριφοράς, και όχι μόνο της συμπεριφοράς κάθε μοντέλου ξεχωριστά. Η έρευνα ασφάλειας Τεχνητής Νοημοσύνης χρειάζεται να κοιτάξει πέρα από τα μεμονωμένα μοντέλα, προς τη συλλογική δυναμική πολλαπλών AI agents που αλληλεπιδρούν.


📖 Πηγές

Groups of AI agents spontaneously form their own social norms without human help
City St George’s, University of London
👉 Διαβάστε περισσότερα

AI “swarms” could fake public consensus and quietly distort democracy
City St George’s, University of London
👉 Διαβάστε περισσότερα

Emergent Social Conventions and Collective Bias in LLM Populations
Science Advances
👉 Διαβάστε την πλήρη μελέτη

Αφήστε ένα Σχόλιο

Το e-mail σας δεν δημοσιεύεται. Τα υποχρεωτικά πεδία σημειώνονται με *


Διαβάστε επίσης

Third-party cookies στο Chrome: Η οριστική κατάληξη

Μετά από 5 χρόνια αναβολών, η Google εγκατέλειψε οριστικά κάθε σχέδιο κατάργησης ή νέας οθόνης επιλογής για τα third-party cookies.

Οι προσπάθειες αναχαίτισης των ransomware αρχίζουν να αποδίδουν καρπούς

Οι κυβερνητικές και βιομηχανικές προσπάθειες για την αναχαίτιση του ransomware αρχίζουν σιγά-σιγά να αποδίδουν καρπούς.

Google Drive: Ανίχνευση ransomware με Τεχνητή Νοημοσύνη

Το Google Drive εντοπίζει επιθέσεις ransomware μέσω Τεχνητής Νοημοσύνης και διακόπτει αυτόματα τον συγχρονισμό για να προστατέψει τα αρχεία σας. Πώς λειτουργεί και σε ποιους απευθύνεται.