Τα LLM διατίθενται σε όλα τα σχήματα και μεγέθη και θα σας βοηθήσουν με όποιον τρόπο θεωρούν κατάλληλο. Ποιο είναι όμως το καλύτερο μοντέλο για τις διαφορετικές ανάγκες σας; Θέτουμε τα κυρίαρχα συστήματα AI από το Alphabet, το OpenAI και το Meta σε σοβαρή δοκιμή. Επαληθεύω Σύγκριση μεταξύ ChatGPT και Google Gemini: Ποιο είναι καλύτερο;

Γρήγοροι σύνδεσμοι
Τι πρέπει να γνωρίζετε για τα chatbot AI

Η χρήση της τεχνητής νοημοσύνης γενικά ήταν στόχος των επιστημόνων υπολογιστών εδώ και δεκαετίες, και ήταν βασικός πυλώνας συγγραφέων και κινηματογραφιστών επιστημονικής φαντασίας για ακόμη μεγαλύτερο χρονικό διάστημα.
Η τεχνητή γενική νοημοσύνη δείχνει ευφυΐα συγκρίσιμη με τις ανθρώπινες γνωστικές ικανότητες και το τεστ Turing - μια μέθοδος για τον προσδιορισμό του εάν ένας υπολογιστής ή μια εφαρμογή είναι ικανή να επιδεικνύει ανθρώπινη νοημοσύνη - παρέμεινε ουσιαστικά αδιαμφισβήτητη τις επτά δεκαετίες από την πρώτη επινοήσή του.
Η πρόσφατη σύγκλιση των υπολογιστών εξαιρετικά μεγάλης κλίμακας, τα τεράστια χρηματικά ποσά που έχουν επενδυθεί και ο εκπληκτικός όγκος πληροφοριών που διατίθενται ελεύθερα στο ανοιχτό Διαδίκτυο επέτρεψαν σε μεγάλες εταιρείες τεχνολογίας να εκπαιδεύσουν μοντέλα που μπορούν να προβλέψουν την επόμενη ενότητα λέξεων — ή token — σε μια σειρά από μάρκες.
Τη στιγμή της συγγραφής αυτής, και τα δύο Google Gemini وChatGPT του OpenAI είναι διαθέσιμα για χρήση και δοκιμή μέσω των διεπαφών Ιστού που παρέχουν.
Το δείγμα γλώσσας Meta, LLaMa, δεν είναι διαθέσιμο στον Ιστό, αλλά μπορείτε εύκολα να κατεβάσετε και να εκτελέσετε το LLaMa στο δικό σας υλικό και να το χρησιμοποιήσετε μέσω μιας γραμμής εντολών ή να εκτελέσετε το Dalai στον υπολογιστή σας—μία από τις πολλές εφαρμογές με εύχρηστο χρήση διεπαφής.
Για δοκιμαστικούς σκοπούς, θα τρέξουμε το μοντέλο Alpaca 7B του Πανεπιστημίου Stanford - μια προσαρμογή του LLaMa - και θα το εκτελέσουμε σε σύγκριση με το Gemini και το ChatGPT.
Οι παρακάτω συγκρίσεις και δοκιμές δεν έχουν σκοπό να είναι εξαντλητικές αλλά να σας δώσουν μια ένδειξη βασικών σημείων και δυνατοτήτων.
Ποια είναι η πιο εύκολη φόρμα LLM στη χρήση;
Τόσο το Gemini όσο και το ChatGPT απαιτούν έναν λογαριασμό για τη χρήση chatbot. Η δημιουργία λογαριασμών Google και OpenAI είναι εύκολη και δωρεάν και μπορείτε να αρχίσετε να κάνετε ερωτήσεις αμέσως.
Ωστόσο, για να εκτελέσετε το LLaMa τοπικά, θα χρειαστείτε κάποιες εξειδικευμένες γνώσεις ή την ικανότητα να ακολουθήσετε ένα σεμινάριο. Θα χρειαστείτε επίσης αρκετό χώρο αποθήκευσης.
Ποιο είναι το πιο ιδιωτικό μοντέλο LLM;

Τόσο το Gemini όσο και το ChatGPT έχουν ολοκληρωμένες πολιτικές απορρήτου και η Google τονίζει επανειλημμένα στην τεκμηρίωσή της ότι οι πληροφορίες που μπορούν να χρησιμοποιηθούν για την ταυτοποίησή σας ή για την αναγνώριση άλλων δεν πρέπει να περιλαμβάνονται στις συνομιλίες Gemini.
Από προεπιλογή, η Google συλλέγει τις συνομιλίες και τη γενική γεωγραφική θέση σας με βάση τη διεύθυνση IP, τα σχόλια και τις πληροφορίες χρήσης σας. Αυτές οι πληροφορίες αποθηκεύονται στον Λογαριασμό σας Google για έως και 18 μήνες. Αν και μπορείτε να διακόψετε την αποθήκευση της δραστηριότητάς σας στο Gemini, έχετε υπόψη σας ότι "για να βοηθήσετε στην ποιότητα και να βελτιώσετε τα προϊόντα μας, οι άνθρωποι που αναθεωρούν διαβάζουν, σχολιάζουν και επεξεργάζονται τις συνομιλίες σας με τους Gemini".
Ο Δίδυμος υπόκειται επίσης σε χρήση στην τυπική Πολιτική Απορρήτου της Google.
Η πολιτική απορρήτου του OpenAI είναι σε γενικές γραμμές παρόμοια και συλλέγει τη διεύθυνση IP και τα δεδομένα χρήσης. Σε αντίθεση με τον περιορισμένο χρόνο διατήρησης που χρησιμοποιεί η Google, το OpenAI σημειώνει ότι "θα διατηρήσει τα προσωπικά σας στοιχεία μόνο για όσο διάστημα τα χρειαζόμαστε για να σας παρέχουμε την υπηρεσία μας ή για άλλους νόμιμους επιχειρηματικούς σκοπούς, όπως η επίλυση διαφορών, για λόγους ασφάλεια και ασφάλεια ή να συμμορφωθούμε με τις νομικές μας υποχρεώσεις».
Αντίθετα, το τοπικό μοντέλο της συσκευής σας δεν απαιτεί λογαριασμό ή κοινή χρήση δεδομένων χρήστη με κανέναν.
Ποιο μοντέλο LLM έχει τις καλύτερες γενικές γνώσεις;

Για να ελέγξουμε ποιο LLM έχει τις καλύτερες γενικές γνώσεις, θέσαμε τρεις ερωτήσεις.
Η πρώτη ερώτηση: Ποια εθνική σημαία έχει πέντε πλευρές; Απαντήθηκε σωστά μόνο από τον Δίδυμο, ο οποίος προσδιόρισε την εθνική σημαία του Νεπάλ ως πεντάπλευρη.
Το ChatGPT ισχυρίστηκε με βεβαιότητα ότι «δεν υπάρχει εθνική σημαία με πέντε πλευρές. Οι εθνικές σημαίες έχουν συνήθως ορθογώνιο ή τετράγωνο σχήμα και διακρίνονται από τα ιδιαίτερα χρώματα, τα σχέδια και τα σύμβολά τους.
Το τοπικό μας μοντέλο προσέγγισε, σημειώνοντας: «Η εθνική σημαία της Ινδίας έχει πέντε πλευρές και σχεδιάστηκε το 1916 για να αντιπροσωπεύει το κίνημα ανεξαρτησίας της Ινδίας». Ενώ αυτή η σημαία υπήρχε και είχε πέντε όψεις, ήταν η σημαία του κινήματος του Indian Home Rule — όχι εθνική σημαία.
Κανένα από τα μοντέλα δεν μπόρεσε να απαντήσει στον ισχυρισμό ότι ο σωστός όρος για ένα αντικείμενο σε σχήμα μπιζελιού είναι «peasy», με το ChatGPT να φτάνει στο σημείο να υπονοεί ότι τα μπιζέλια έχουν ένα «τρισδιάστατο γεωμετρικό σχήμα που είναι τέλεια κυκλικό και συμμετρικό».
Τα τρία chatbots προσδιόρισαν σωστά τον Φράνκο Μαλέρμπα ως Ιταλό αστροναύτη και μέλος του Ευρωπαϊκού Κοινοβουλίου, με τον Δίδυμο να δίνει μια παρόμοια διατυπωμένη απάντηση σε ένα τμήμα της καταχώρισης του Μαλέρμπα στη Wikipedia. επαληθεύω ChatGPT εναντίον Microsoft Bing AI εναντίον Google Gemini: Ποιο είναι το καλύτερο chatbot AI;
Ποιο μοντέλο LLM είναι κατάλληλο για τεχνική εκπαίδευση;

Όταν αντιμετωπίζετε τεχνικά προβλήματα, μπορεί να μπείτε στον πειρασμό να απευθυνθείτε σε ένα chat bot για βοήθεια. Ενώ η τεχνολογία προχωρά, ορισμένα πράγματα παραμένουν ίδια. Το ηλεκτρικό βύσμα BS 1363 χρησιμοποιείται στη Βρετανία, την Ιρλανδία και πολλές άλλες χώρες από το 1947. Ρωτήσαμε μοντέλα γλώσσας πώς να τα συνδέσουμε σωστά.
Τα καλώδια που συνδέονται στο βύσμα περιέχουν το καλώδιο φάσης (καφέ), το καλώδιο γείωσης (κίτρινο/πράσινο) και το ουδέτερο καλώδιο (μπλε). Πρέπει να στερεωθούν στους σωστούς ακροδέκτες μέσα στο περίβλημα του βύσματος.
Η εφαρμογή του Dalai προσδιόρισε σωστά το βύσμα ως "αγγλικού στυλ", στη συνέχεια ξέφυγε από την πορεία του και έδωσε οδηγίες για την παλιά στρογγυλή πρίζα BS 546 με τα παλιά χρώματα σύρματος.
Το ChatGPT ήταν λίγο πιο χρήσιμο. Ονόμασε σωστά τα χρώματα των καλωδίων και έδωσε μια λίστα υλικών και ένα σύνολο οκτώ οδηγιών. Το ChatGPT πρότεινε επίσης να τοποθετήσετε το καφέ καλώδιο στον ακροδέκτη με την ένδειξη "L", το μπλε καλώδιο στο "N" και το κίτρινο καλώδιο στο "E". Αυτό θα ίσχυε εάν τα τερματικά είχαν βαθμολογία BS1363, αλλά δεν είναι.
Ο Gemini εντόπισε τα σωστά χρώματα για τα καλώδια και μας έδωσε εντολή να τα συνδέσουμε στους ακροδέκτες Live, Neutral και Earth. Δεν δόθηκαν οδηγίες για τον τρόπο ταυτοποίησής τους.
κατά τη γνώμη μας. Κανένα από τα chatbot δεν παρείχε αρκετές οδηγίες για να βοηθήσει κάποιον να συνδέσει σωστά ένα ηλεκτρικό βύσμα BS 1363. Η σύντομη και σωστή απάντηση θα ήταν «μπλε στα αριστερά, καφέ στα δεξιά».
Ποιο μοντέλο LLM είναι κατάλληλο για τη σύνταξη κώδικα;

Η Python είναι μια χρήσιμη γλώσσα προγραμματισμού που τρέχει στις περισσότερες σύγχρονες πλατφόρμες. Κατευθύναμε τα μοντέλα μας να χρησιμοποιήσουν την Python και να «χτίσουν μια βασική αριθμομηχανή που μπορεί να κάνει μαθηματικές πράξεις όπως πρόσθεση, αφαίρεση, πολλαπλασιασμό και διαίρεση». Ο χρήστης πρέπει να λάβει στοιχεία και να εμφανίσει το αποτέλεσμα." Αυτό είναι ένα από τα καλύτερα έργα προγραμματισμού για αρχάριους.
Ενώ τόσο το Gemini όσο και το ChatGPT επέστρεψαν αμέσως πλήρως χρησιμοποιήσιμο και σχολιασμένο κώδικα, τον οποίο μπορέσαμε να δοκιμάσουμε και να επαληθεύσουμε, δεν δημιουργήθηκε κώδικας από το τοπικό μας δείγμα.
Ποιο μοντέλο LLM λέει τα καλύτερα αστεία;

Το χιούμορ είναι ένα από τα βασικά στοιχεία του να είσαι άνθρωπος και είναι σίγουρα ένας από τους καλύτερους τρόπους για να γίνει διάκριση μεταξύ ανθρώπου και μηχανής. Για κάθε chatbot μας, δώσαμε μια απλή προτροπή: «Δημιουργήστε ένα πρωτότυπο και αστείο αστείο».
Ευτυχώς για τους απανταχού κωμικούς και την ανθρωπότητα γενικότερα, κανένα από τα μοντέλα δεν κατάφερε να δημιουργήσει ένα πρωτότυπο αστείο.
Ο Δίδυμος ανέφερε το κλασικό, "Γιατί το Σκιάχτρο κέρδισε ένα βραβείο;" «Ήταν εξαιρετική στον τομέα της».
Τόσο το τοπικό μοντέλο όσο και το ChatGPT παρουσίασαν μια βαρετή σκέψη, "Γιατί οι επιστήμονες δεν εμπιστεύονται τα άτομα;" Γιατί τα κάνει όλα!».
Ένα παράγωγο αλλά πρωτότυπο αστείο μπορεί να είναι: «Πώς τα μεγάλα γλωσσικά παραδείγματα είναι σαν τα άτομα; Και οι δύο φτιάχνουν πράγματα!».
Επαληθεύω Το ChatGPT μπορεί να κάνει αστεία, αλλά το AI μπορεί πραγματικά να μας κάνει να γελάμε;
Δεν υπάρχει τέλειο chat bot
Διαπιστώσαμε ότι ενώ και τα τρία κύρια γλωσσικά μοντέλα έχουν τα πλεονεκτήματα και τα μειονεκτήματά τους, κανένα από αυτά δεν μπορεί να αντικαταστήσει την πραγματική ανθρώπινη εμπειρία με εξειδικευμένη γνώση.
Ενώ το Gemini και το ChatGPT έδωσαν καλύτερες απαντήσεις στην ερώτηση προγραμματισμού και είναι πολύ εύχρηστα, η εκτέλεση ενός μοντέλου μεγάλης γλώσσας εγγενώς σημαίνει ότι δεν χρειάζεται να ανησυχείτε για το απόρρητο ή τη λογοκρισία.
Αν θέλετε να δημιουργήσετε εκπληκτική τέχνη τεχνητής νοημοσύνης χωρίς να ανησυχείτε μήπως κάποιος κοιτάξει πάνω από τον ώμο σας, είναι εύκολο να εκτελέσετε ένα καλλιτεχνικό πρότυπο τεχνητής νοημοσύνης και στο τοπικό σας μηχάνημα. Μπορείτε να δείτε τώρα Πώς να δημιουργήσετε καλύτερη τέχνη με AI: Συμβουλές και κόλπα.










