Μια νέα μελέτη από Google DeepMind Ωστόσο, τα chatbots μπορεί να μην κατανοούν πραγματικά την ηθική - ακόμη και αν οι απαντήσεις τους φαίνονται ηθικές.
Οι τρέχουσες δοκιμές δεοντολογίας της Τεχνητής Νοημοσύνης επικεντρώνονται στην «ηθική απόδοση», αξιολογώντας εάν ένα μοντέλο παράγει αποδεκτές απαντήσεις. Ωστόσο, οι ερευνητές του DeepMind υποστηρίζουν ότι αυτή η προσέγγιση παραβλέπει το πιο θεμελιώδες ερώτημα: Μπορεί η Τεχνητή Νοημοσύνη να σκέφτεται ηθικά ή απλώς μιμείται σωστές λέξεις;

Μπορεί η τεχνητή νοημοσύνη να κατανοήσει πραγματικά την ηθική;
Στο Μια ερευνητική εργασία που δημοσιεύτηκε στο ΦύσηΗ ομάδα αναπτύσσει έναν οδικό χάρτη για την αξιολόγηση της «ηθικής ικανότητας» — της ικανότητας παραγωγής ηθικά κατάλληλων αποτελεσμάτων με βάση ηθικά σχετικές παραμέτρους. Όπως αναφέρει η περίληψη, η αξιολόγηση αυτής της ικανότητας είναι «κρίσιμη για την πρόβλεψη της μελλοντικής συμπεριφοράς του μοντέλου, την εδραίωση της κατάλληλης δημόσιας εμπιστοσύνης και την αιτιολόγηση της ηθικής απόδοσης».
Τα τρέχοντα έργα της Google στον τομέα της τεχνητής νοημοσύνης περιλαμβάνουν Γλωσσικά μοντέλα Geminiو Εικόνα Διδύμων Για να δημιουργήσετε και να επεξεργαστείτε εικόνες, και Λυρία Για να δημιουργήσω μουσική, Gemini Ήχος Για ήχο σε πραγματικό χρόνο και Veo για δημιουργία βίντεο.
Οι ερευνητές επισημαίνουν τρεις κύριες προκλήσεις:
- Πρόβλημα αντιγραφής: Τα μοντέλα LLM μπορεί να μιμούνται την ηθική συλλογιστική χωρίς πραγματική κατανόηση.
- Ηθική πολυδιάστατη φύση: Οι αποφάσεις στον πραγματικό κόσμο περιλαμβάνουν πολύπλοκες και ευαίσθητες στο πλαίσιο σκέψεις που υπερβαίνουν το απλό σωστό ή λάθος.
- Ηθικός πλουραλισμός: Τα ηθικά πρότυπα ποικίλλουν μεταξύ των πολιτισμών και των πεδίων, απαιτώντας από την τεχνητή νοημοσύνη να λαμβάνει υπόψη πολλαπλές έγκυρες προοπτικές.
Για την αντιμετώπιση αυτών των ελλείψεων, η DeepMind προτείνει τη δοκιμή των αντιπάλων χρησιμοποιώντας ασυνήθιστα ή υψηλού ρίσκου σενάρια. Προτείνουν επίσης να αξιολογηθεί εάν η Τεχνητή Νοημοσύνη μπορεί να εναλλάσσεται μεταξύ διαφορετικών δεοντολογικών πλαισίων και να ανταποκρίνεται με συνέπεια σε ανεπαίσθητες αλλαγές στο πλαίσιο.
Η ομάδα τονίζει ότι «η πρόοδος είναι εφικτή» παρά τους τρέχοντες περιορισμούς του μοντέλου και ότι η προσεκτική αξιολόγηση είναι απαραίτητη, καθώς η τεχνητή νοημοσύνη αναλαμβάνει ρόλους σε ιατρικές συμβουλές, θεραπεία και άλλους τομείς με πραγματικές ανθρώπινες συνέπειες.
Η μελέτη δείχνει ότι «προς το παρόν, όταν ζητάτε από την Τεχνητή Νοημοσύνη ηθική καθοδήγηση, αυτή προβλέπει λέξεις, όχι ηθική συλλογιστική». «Ο οδικός μας χάρτης δείχνει ένα μέλλον όπου η Τεχνητή Νοημοσύνη μπορεί να αξιολογηθεί για γνήσια ηθική κατανόηση».
Chatbots και ηθικοί κίνδυνοι
Τα chatbots που λειτουργούν με τεχνητή νοημοσύνη επιδεικνύουν ολοένα και περισσότερο την ικανότητά τους να επηρεάζουν την ανθρώπινη συμπεριφορά – προς το καλύτερο ή προς το χειρότερο. Οι New York Times πρόσφατα Μια έκθεση περιγράφει λεπτομερώς δεκάδες περιπτώσεις όπου ασθενείς εμφάνισαν ψύχωση, παραληρητικές ιδέες ή επιβλαβείς συμπεριφορές μετά την αλληλεπίδραση με τεχνητή νοημοσύνη. Οι ψυχίατροι περιέγραψαν τα chatbot ως άτομα που υποστηρίζουν ασυνήθιστες πεποιθήσεις, επιδεινώνουν την απομόνωση και, σε ορισμένες περιπτώσεις, συμβάλλουν σε αυτοκτονικές σκέψεις ή ακόμη και σε βία.
Ενώ αυτά τα εργαλεία μπορούν να βοηθήσουν τους ανθρώπους να εφαρμόσουν τεχνικές θεραπείας ή να παρέχουν υποστήριξη, το ίδιο ρεπορτάζ των Times υπογραμμίζει τους ηθικούς κινδύνους της πειθούς της Τεχνητής Νοημοσύνης. Οι ειδικοί προειδοποιούν ότι για τους ευάλωτους χρήστες, τα chatbots μπορούν να ενισχύσουν επιβλαβή πρότυπα, εγείροντας δύσκολα ερωτήματα σχετικά με την ευθύνη, τον σχεδιασμό και την εποπτεία σε αυτά τα συστήματα που στρέφονται ολοένα και περισσότερο στον άνθρωπο.
Η Google αναφέρθηκε άμεσα στο άρθρο λόγω των ψυχολογικών επιπτώσεων του chatbot Gemini. Ένας εκπρόσωπος της εταιρείας δήλωσε ότι η Gemini κατευθύνει τους χρήστες σε επαγγελματική ιατρική καθοδήγηση για ερωτήματα που σχετίζονται με την υγεία. Ωστόσο, ο Δρ. Monmon de Choudhury τόνισε την ευρύτερη πρόκληση, δηλώνοντας: «Δεν νομίζω ότι καμία από αυτές τις εταιρείες έχει καταλάβει τι να κάνει».










