Σε ένα αμφιλεγόμενο μέτρο προχώρησε αυτές τις μέρες η εταιρεία Τεχνητής Νοημοσύνης Anthropic σχετικά με την πολιτική χρήσης των μεγάλων γλωσσικών μοντέλων της (Claude).
Στον επικαιροποιημένο κατάλογο που δημοσίευσε η εταιρεία, παρουσιάζει τους νέους κανόνες όσον αφορά τη χρήση του Claude και τα μέτρα που έλαβε κατά επικίνδυνων πρακτικών, όπως της χρήσης των μοντέλων της για τη νοθεία εκλογών, την εξαπάτηση ανθρώπων, την ανάπτυξη όπλων, τη βλάβη ανθρώπων (οικονομική, νομική, υγείας κ.ά).
Μεταξύ αυτών των σοβαρών κινδύνων, όμως, η Anthropic πρόσθεσε ένα ακόμα μέτρο, την απαγόρευση λεκτικής κακοποίησης των μοντέλων τεχνητής νοημοσύνης από τους χρήστες!
Συγκεκριμένα η πολιτική χρήσης της Anthropic αναφέρει: «Προσθέσαμε μια απαγόρευση σχετικά με την παρατεταμένη και αδικαιολόγητη υβριστική ή σκληρή συμπεριφορά απέναντι στα μοντέλα μας. Η επικαιροποίηση της πολιτικής αφορά μόνο ακραίες περιπτώσεις, όπου οι χρήστες επιδεικνύουν επανειλημμένα σκληρή συμπεριφορά προς τα μοντέλα μας, χωρίς κάποιον προφανή σκοπό.
Δεν αφορά τις συνηθισμένες εκδηλώσεις εκνευρισμού ή αντίδρασης από την πλευρά του χρήστη, τη χρήση σκοτεινών θεματικών στο πλαίσιο της δημιουργικής διαδικασίας, ούτε τις δοκιμές και την έρευνα στα μοντέλα. Η προσθήκη αυτή ευθυγραμμίζεται με ένα μέτρο που έχουμε ήδη εφαρμόσει, επιτρέποντας στα μοντέλα Claude να τερματίζουν σπάνιες συνομιλίες με χρήστες που επιδεικνύουν επίμονη υβριστική συμπεριφορά στο Claude.ai και στο Claude Code».
Η πολιτική αυτή μόλις δημοσιοποιήθηκε δέχθηκε σφοδρή κριτική στα social media. Πολλοί πολίτες είδαν στο μέτρο είτε έμμεση παραδοχή της εταιρείας ότι τα μοντέλα της έχουν αποκτήσει συνείδηση, είτε ότι είναι παντελώς άχρηστο επειδή ακριβώς η Τεχνητή Νοημοσύνη δεν έχει συνείδηση και συναισθήματα για να μπορεί να θεωρηθεί ότι η υβριστική συμπεριφορά απέναντί της την θίγει, καθώς πρόκειται απλά για υπολογιστικά γλωσσικά μοντέλα.
Η επικίνδυνη ανθρωποποίηση της AI
Παράλληλα από πολλούς τονίστηκε η προβληματική προσέγγιση της εταιρείας που μέσω (και) αυτής της πολιτικής προωθεί την ανθρωποποίηση της Τεχνητής Νοημοσύνης.
Η πρακτική απόδοσης/ενσωμάτωσης ανθρωπόμορφων χαρακτηριστικών στην Τεχνητή Νοημοσύνη έχει εφαρμοστεί εξαρχής από τις εταιρείες σε όλα τα μεγάλα γλωσσικά μοντέλα καθώς έτσι κάνουν τη λειτουργία τους πιο ευχάριστη στους χρήστες, παρατείνοντας τη διάρκεια χρήσης τους και άρα τα κέρδη που αποκομίζουν οι εν λόγω εταιρείες.
Μέσω εκφράσεων που υποδηλώνουν συναίσθημα, αντίληψη, βιωματικές εμπειρίες κ.ά. (πχ πολύ χαίρομαι για την ερώτησή σου ή λυπάμαι που έδωσα λάθος απάντηση ή στις πόλεις είμαστε πιο απομακρυσμένοι από τη φύση κλπ) τα μεγάλα γλωσσικά μοντέλα έχουν σχεδιαστεί ώστε να δημιουργούν οικειότητα, ενθαρρύνοντας την επανάχρηση.
Το πρόβλημα είναι πως μέσω αυτών των σχεδιαστικών λειτουργιών και της οικειότητας προκαλούν και το αίσθημα εμπιστοσύνης, δημιουργώντας έτσι την ψευδαίσθηση της αυθεντίας της Τεχνητής Νοημοσύνης, μέχρι και την ανάπτυξη συναισθηματικού δεσμού, με κάποιους ανθρώπους να έχουν φθάσει στο σημείο να πιστεύουν πως έχουν ερωτική σχέση με μεγάλα γλωσσικά μοντέλα. Για την ακρίβεια, έρευνα της Vantage Point κατέγραψε πως στις ΗΠΑ το 28,16% του ενήλικου πληθυσμού είχε ερωτική σχέση με μοντέλο Τεχνητής Νοημοσύνης (συμπεριλαμβανομένων των ειδικών προϊόντων AI για αυτή τη χρήση αλλά όχι μόνο).
Σενάρια επιβίωσης των κολοσσών της Τεχνητής Νοημοσύνης
Την ίδια ώρα που η Anthropic απαγορεύει την άσχημη συμπεριφορά απέναντι στα προϊόντα της από τους χρήστες, η εταιρεία εξετάζει μαζί με την OpenAI, και άλλες επιχειρήσεις που δραστηριοποιούνται στον τομέα, σενάρια για την επόμενη μέρα μετά από ένα πιθανό καταστροφικό συμβάν που θα οφείλεται στα μοντέλα τους, σύμφωνα με ρεπορτάζ του Axios.
Τα σενάρια που κάνουν αφορούν πιθανή κυβερνοεπίθεση από δράση αυτόνομων μοντέλων Τεχνητής Νοημοσύνης που θα ξεφύγουν του ανθρώπινου ελέγχου και θα μπορούσαν να «διακόψουν την πρόσβαση σε χρηματοοικονομικές υπηρεσίες, στο διαδίκτυο ή ακόμα και στην παροχή ηλεκτρικού ρεύματος και νερού».
Τα εν λόγω σχέδια προετοιμασίας τους, όμως, δεν αφορούν στο πώς θα βοηθήσουν τους πληγέντες ανθρώπους από την καταστροφή που θα προκαλούσαν τα προϊόντα τους, αλλά πώς θα αντιμετωπίσουν οι μεγιστάνες της AI την πιθανή κοινωνική οργή από ένα τέτοιο συμβάν.
Όπως σημειώνεται στο ρεπορτάζ του Axios «Ανώτατα στελέχη των εταιρειών Anthropic, OpenAI και άλλων εταιρειών τεχνητής νοημοσύνης εξετάζουν ιδιωτικά σενάρια για μια δημόσια και πολιτική εξέγερση (…) Το πρώτο παράδειγμα σημαντικής βλάβης στον πραγματικό κόσμο, που θα προκληθεί από μη ασφαλή τεχνητή νοημοσύνη, θα έστρεφε ακόμη περισσότερο το ήδη επιφυλακτικό κοινό εναντίον της τεχνολογίας και των ηγετών της, συμπεριλαμβανομένων του Διευθύνοντος Συμβούλου της Anthropic, Ντάριο Αμοντέι, και του Διευθύνοντος Συμβούλου της OpenAI, Σαμ Άλτμαν, καθώς και του Προέδρου Τραμπ λόγω της απροθυμίας του να θεσπίσει ρυθμιστικούς κανόνες».

