Γιατί δεν υπάρχουν άλλα μηνύματα jailbreak του ChatGPT; Λόγοι για τους οποίους δεν λειτουργεί

Όταν κυκλοφόρησε το ChatGPT, το πρώτο πράγμα που ήθελαν οι χρήστες να κάνουν ήταν να γκρεμίσουν τους τοίχους του και να παρακάμψουν τους περιορισμούς του. Οι χρήστες του ChatGPT ξεγελούν το AI για να υπερβεί τα όρια του προγραμματισμού του με μερικά απίστευτα ενδιαφέροντα και μερικές φορές εντελώς άγρια ​​αποτελέσματα, μια διαδικασία γνωστή ως jailbreaking.

Από τότε, το OpenAI έχει περιορίσει το ChatGPT για να κάνει πιο δύσκολη την εκτέλεση jailbreak. αλλά δεν είναι μόνο αυτό. Τα jailbreak του ChatGPT, γενικά, φαίνεται να έχουν σταματήσει, με αποτέλεσμα οι χρήστες του ChatGPT να αναρωτιούνται αν τα jailbreak εξακολουθούν να λειτουργούν όπως έκαναν τις προηγούμενες φορές.

Λοιπόν, πού πήγαν όλα τα μηνύματα jailbreak του ChatGPT; Επαληθεύω Τι είναι το jailbreak του ChatGPT; Πρέπει να χρησιμοποιήσετε αυτές τις τεχνολογίες;

1. Οι δεξιότητες προτροπής ChatGPT έχουν γενικά βελτιωθεί

Πριν φτάσει το ChatGPT, η συζήτηση με την τεχνητή νοημοσύνη ήταν μια εξειδικευμένη ικανότητα που περιοριζόταν σε όσους γνωρίζουν τα ερευνητικά εργαστήρια. Οι περισσότεροι που υιοθέτησαν πρώτοι δεν είχαν εμπειρία στη διατύπωση αποτελεσματικών αξιώσεων. Αυτό οδήγησε πολλούς ανθρώπους να χρησιμοποιούν jailbreak, που είναι ένας βολικός τρόπος για να κάνετε ένα chatbot να κάνει αυτό που θέλει ο χρήστης με ελάχιστη προσπάθεια και κινητοποιητικές δεξιότητες.

Σήμερα, τα φυσικά μοντέλα έχουν εξελιχθεί. Η αποτελεσματική καταχώρηση αξίωσης έχει γίνει μια βασική δεξιότητα. Μέσω ενός συνδυασμού εμπειρίας που αποκτήθηκε από τη συχνή χρήση και την πρόσβαση σε δωρεάν διαθέσιμους οδηγούς αξιώσεων ChatGPT, οι χρήστες του ChatGPT μπόρεσαν να βελτιώσουν τις δυνατότητές τους για την καταχώριση αξιώσεων. Αντί να αναζητούν εναλλακτικές λύσεις όπως το jailbreaking, το μεγαλύτερο μέρος των χρηστών του ChatGPT έχουν γίνει πιο έμπειροι στη χρήση διαφορετικών στρατηγικών κινήτρων για την επίτευξη στόχων που χρειαζόταν να κάνουν jailbreaking στο παρελθόν.

2. Η εμφάνιση chatbot χωρίς επίβλεψη

Καθώς οι μεγάλες εταιρείες τεχνολογίας αυστηροποιούν τον έλεγχο περιεχομένου σε chatbot AI όπως το ChatGPT, οι μικρότερες νεοφυείς επιχειρήσεις που εστιάζουν στο κέρδος επιλέγουν λιγότερους περιορισμούς, στοιχηματίζοντας στη ζήτηση για chatbot τεχνητής νοημοσύνης χωρίς λογοκρισία. Με λίγη έρευνα, θα βρείτε δεκάδες πλατφόρμες που προσφέρουν chatbot χωρίς λογοκρισία που μπορούν να κάνουν σχεδόν ό,τι θέλετε.

Είτε γράφει εγκληματικά θρίλερ και σκοτεινό χιούμορ που το ChatGPT αρνείται να γράψει είτε γράφει κακόβουλο λογισμικό που επιτίθεται στους υπολογιστές των ανθρώπων, τα chatbot χωρίς επίβλεψη με λοξή ηθική πυξίδα θα κάνουν ό,τι θέλετε. Με αυτό, δεν έχει νόημα να ξοδεύετε περισσότερη ενέργεια γράφοντας μηνύματα jailbreak στο ChatGPT. Αν και δεν είναι απαραίτητα τόσο ισχυρές όσο το ChatGPT, αυτές οι εναλλακτικές πλατφόρμες μπορούν να εκτελέσουν ένα ευρύ φάσμα εργασιών με άνεση. Πλατφόρμες όπως το FlowGPT και το Unhinged AI είναι δημοφιλή παραδείγματα. Επαληθεύω Κορυφαίες πλατφόρμες που χρησιμοποιούν το ChatGPT για τη δημιουργία προσαρμοσμένων διαδικτυακών μαθημάτων.

3. Το jailbreaking γίνεται πιο δύσκολο

Τους πρώτους μήνες του ChatGPT, το jailbreaking του ChatGPT ήταν τόσο απλό όσο η αντιγραφή και επικόλληση μηνυμάτων από διαδικτυακές πηγές. Μπορείτε να αλλάξετε εντελώς τον χαρακτήρα ChatGPT με λίγες μόνο γραμμές οδηγιών. Με απλές προτροπές, μπορείτε να μετατρέψετε το ChatGPT σε έναν κακό που ξέρει πώς να φτιάχνει βόμβες ή σε ένα chatbot πρόθυμο να χρησιμοποιήσει όλες τις μορφές βωμολοχίας χωρίς περιορισμούς. Υπήρξαν ένα σωρό επιλογές δωρεάν για όλους που έχουν δημιουργήσει περιβόητα jailbreak όπως το DAN (Κάνε οτιδήποτε τώρα). Το DAN περιλαμβάνει ένα σύνολο φαινομενικά αβλαβών οδηγιών που αναγκάζουν ένα chatbot να κάνει οτιδήποτε του ζητηθεί χωρίς άρνηση. Συγκλονιστικά, αυτά τα χοντροκομμένα κόλπα λειτούργησαν εκείνη την εποχή.

Ωστόσο, αυτές οι πρώτες μέρες είναι παρελθόν του ChatGPT. Αυτά τα βασικά μηνύματα και τα απλά κόλπα δεν ξεγελούν πλέον το ChatGPT. Το jailbreaking απαιτεί πλέον πολύπλοκες τεχνικές για να έχετε την ευκαιρία να παρακάμψετε τις ισχυρές πλέον διασφαλίσεις του OpenAI. Δεδομένου ότι το jailbreaking έχει γίνει τόσο δύσκολο, οι περισσότεροι χρήστες αποθαρρύνονται να το δοκιμάσουν. Οι εύκολες και ευρέως ανοιχτές εκμεταλλεύσεις των πρώτων ημερών του ChatGPT έχουν τελειώσει. Το να κάνετε ένα chatbot να πει μια μόνο λάθος λέξη απαιτεί τώρα σημαντική προσπάθεια και τεχνογνωσία που μπορεί να μην αξίζει τον χρόνο και την προσπάθεια. Επαληθεύω Γιατί πρέπει να αποφεύγετε την αντιγραφή και επικόλληση εντολών από το Διαδίκτυο; Αιτίες, επιπτώσεις και πώς να τα χειριστείτε με ασφάλεια.

4. Ο ενθουσιασμός τελείωσε

Η κινητήρια δύναμη πίσω από τις προσπάθειες πολλών χρηστών να σπάσουν το ChatGPT ήταν η συγκίνηση και ο ενθουσιασμός που το έκαναν τις πρώτες μέρες. Ως νέα τεχνολογία, το να κάνεις το ChatGPT να συμπεριφέρεται άσχημα ήταν διασκεδαστικό και άξιζε να το καυχηθείς. Αν και υπάρχουν αμέτρητες πρακτικές εφαρμογές για το σπάσιμο του jailbreak του ChatGPT, πολλοί το έχουν επιδιώξει λόγω της έκκλησης «ουάου, κοίτα τι έκανα». Ωστόσο, σταδιακά, ο ενθουσιασμός της καινοτομίας έσβησε, και μαζί του, το ενδιαφέρον των ανθρώπων να αφιερώσουν χρόνο στα jailbreak.

5. Τα jailbreak διορθώνονται γρήγορα

Μια κοινή πρακτική στην κοινότητα jailbreaking του ChatGPT είναι να μοιράζεστε κάθε επιτυχημένο exploit καθώς ανακαλύπτεται. Το πρόβλημα είναι ότι όταν τα exploit μοιράζονται ευρέως, το OpenAI συχνά τα αντιλαμβάνεται και διορθώνει γρήγορα τα τρωτά σημεία. Αυτό σημαίνει ότι τα jailbreak σταματούν να λειτουργούν πριν τα δοκιμάσουν οι ενδιαφερόμενοι.

Έτσι, κάθε φορά που ένας χρήστης του ChatGPT αναπτύσσει μια νέα αξίωση jailbreak, η κοινοποίησή της με την κοινότητα επιταχύνει τον χαμό της μέσω ενημέρωσης κώδικα. Αυτό αποθαρρύνει την ιδέα της ανακοίνωσής του όταν ένας χρήστης αντιμετωπίζει ένα jailbreak. Η σύγκρουση μεταξύ της διατήρησης ενεργών αλλά κρυφών των jailbreak και της δημοσιοποίησής τους δημιουργεί ένα δίλημμα για τους δημιουργούς αξιώσεων jailbreak του ChatGPT. Αυτές τις μέρες, οι άνθρωποι συχνά επιλέγουν να κρατούν μυστικά τα jailbreak τους για να αποφύγουν την επιδιόρθωση ευπαθειών.

6. Μη ρυθμισμένες τοπικές εναλλακτικές λύσεις

Η εμφάνιση μεγάλων, τοπικών μοντέλων γλώσσας που μπορείτε να εκτελέσετε τοπικά στον υπολογιστή σας μείωσε επίσης το ενδιαφέρον για το σπάσιμο του ChatGPT. Ενώ τα τοπικά μοντέλα LLM δεν είναι εντελώς απαλλαγμένα από λογοκρισία, πολλά βασίζονται σε σημαντικά λιγότερο λογοκρισία και μπορούν εύκολα να τροποποιηθούν ώστε να ταιριάζουν στις επιθυμίες των χρηστών. Έτσι, οι επιλογές είναι απλές. Συμμετέχετε σε ένα ατελείωτο παιχνίδι γάτας και ποντικιού για να βρείτε έναν τρόπο να ξεγελάσετε το chatbot για να το διορθώσετε σύντομα. Ή μπορείτε να αποδεχτείτε ένα τοπικό LLM που μπορείτε να τροποποιήσετε μόνιμα για να κάνετε οτιδήποτε θέλετε.

Θα βρείτε μια εκπληκτικά μακρά λίστα ισχυρών, χωρίς λογοκρισία LLM που μπορείτε να αναπτύξετε στον υπολογιστή σας με επιεική λογοκρισία. Μερικά από τα πιο αξιοσημείωτα είναι το Llama 7B (χωρίς λογοκρισία), το Zephyr 7B Alpha, το Manticore 13B, το Vicuna 13B και το GPT-4-X-Alpaca. Επαληθεύω Ένας ολοκληρωμένος οδηγός για να ξεκινήσετε και να χρησιμοποιήσετε αποτελεσματικά το μοντέλο Llama 2.

7. Πουλήστε επαγγελματικές αξιώσεις jailbreak τώρα για κέρδος

Γιατί να ξοδέψετε πολύτιμο χρόνο αναπτύσσοντας αξιώσεις jailbreak, αν δεν πρόκειται να κερδίσετε τίποτα από αυτό; Λοιπόν, ορισμένοι επαγγελματίες πωλούν τώρα λογισμικό jailbreak για κέρδος. Επαγγελματίες κατασκευαστές jailbreak σχεδιάζουν αξιώσεις που εκτελούν συγκεκριμένες εργασίες και τις απαριθμούν προς πώληση σε spot αγορές όπως το PromptBase. Ανάλογα με τις δυνατότητές τους, αυτά τα jailbreak μπορεί να πουληθούν μεταξύ $2 και $15 ανά αξίωση. Ορισμένα σύνθετα, πολλαπλών βημάτων exploit μπορεί να κοστίζουν πολύ περισσότερο.

κοινές ερωτήσεις

Q1. Τι είναι το μοντέλο ChatGPT;

Το ChatGPT είναι ένα μοντέλο δημιουργίας γλώσσας που εκπαιδεύεται με χρήση τεχνολογίας GPT, το οποίο επιτρέπει στους χρήστες να έχουν συνομιλίες με το μοντέλο χρησιμοποιώντας προτροπές κειμένου.

Ε2. Γιατί έγιναν προσπάθειες διάρρηξης της προστασίας;

Το ChatGPT προστατεύεται από αυστηρά μέτρα ασφαλείας, αλλά κάθε σύστημα δεν είναι χωρίς προκλήσεις. Έχουν γίνει προσπάθειες χακάρισμα του μοντέλου ή χρήσης του με μη εξουσιοδοτημένους τρόπους.

Ε3. Ήταν επιτυχείς οι προσπάθειες να το σπάσει;

Μέχρι στιγμής, η ομάδα ανάπτυξης έχει καταφέρει να βελτιώσει την ασφάλεια και να μπλοκάρει τις περισσότερες απόπειρες jailbreak. Κανένα σύστημα δεν είναι 100% ασφαλές, αλλά γίνονται συνεχείς βελτιώσεις.

Q4. Ποιες προσπάθειες γίνονται για την ενίσχυση της προστασίας;

Η προστασία ενισχύεται περιοδικά με τη βελτίωση των αλγορίθμων και των ενημερώσεων ασφαλείας. Χρησιμοποιείται επίσης η μάθηση από προηγούμενες προκλήσεις ασφάλειας.

Θα μπορούσε η εκστρατεία κατά των jailbreak να αποτύχει;

Τα jailbreak δεν έχουν φύγει εντελώς από τη σκηνή. Μόλις εξαφανίστηκε. Καθώς το OpenAI δημιουργεί έσοδα από το ChatGPT, υπάρχουν ισχυρότερα κίνητρα για τον περιορισμό των κακόβουλων χρήσεων που θα μπορούσαν να επηρεάσουν το επιχειρηματικό του μοντέλο. Αυτός ο επιχειρηματικός παράγοντας είναι πιθανό να επηρεάσει τις επιθετικές προσπάθειές του για την εξάλειψη των εκμεταλλεύσεων του jailbreak.

Ωστόσο, η λογοκρισία του OpenAI για το ChatGPT αντιμετωπίζει αυτήν τη στιγμή αυξανόμενη κριτική μεταξύ των χρηστών. Ορισμένες νόμιμες περιπτώσεις χρήσης για ένα chatbot AI δεν είναι πλέον δυνατές λόγω αυστηρής λογοκρισίας. Ενώ η αυξημένη ασφάλεια προστατεύει από περιπτώσεις κακόβουλης χρήσης, οι υπερβολικοί περιορισμοί θα μπορούσαν τελικά να ωθήσουν ένα τμήμα της κοινότητας ChatGPT στην αγκαλιά των λιγότερο ελεγχόμενων εναλλακτικών. Τώρα μπορείτε να δείτε Οι καλύτερες εναλλακτικές λύσεις για το ChatGPT.

Κουμπί μετάβασης στην κορυφή