Το μοντέλο GPT-4 του OpenAI είναι μακράν το καλύτερο μοντέλο παραγωγής τεχνητής νοημοσύνης που διατίθεται αυτή τη στιγμή στην αγορά, αλλά αυτό δεν σημαίνει ότι δεν κοιτάμε το μέλλον. Με τον Διευθύνοντα Σύμβουλο του OpenAI, Sam Altman, να κάνει τακτικά υποδείξεις για την επικείμενη άφιξη του GPT-5, φαίνεται πιθανό ότι θα δούμε σύντομα ένα νέο, ενημερωμένο και πιο προηγμένο μοντέλο AI.
Τουλάχιστον, αυτό ελπίζουμε. Δεν υπάρχει καθορισμένη ημερομηνία κυκλοφορίας για το GPT-5 και τα περισσότερα από αυτά που πιστεύουμε ότι γνωρίζουμε προέρχονται από τη συγκέντρωση άλλων πληροφοριών και την προσπάθεια σύνδεσης των κουκκίδων μεταξύ τους. Επαληθεύω Λόγοι για να αρχίσετε να χρησιμοποιείτε το Claude 3 αντί για το ChatGPT.

Ωστόσο, ανεξάρτητα από την ημερομηνία παράδοσης, υπάρχουν ορισμένα βασικά χαρακτηριστικά που θα θέλαμε να δούμε κατά την κυκλοφορία του GPT-5.
Γρήγοροι σύνδεσμοι
Τι είναι το GPT-5 του OpenAI;
Το μοντέλο GPT-5 είναι ο υποψήφιος διάδοχος του μοντέλου GPT-4 AI του OpenAI, το οποίο αναμένεται ευρέως να είναι το πιο ισχυρό μοντέλο παραγωγής στην αγορά. Αν και δεν υπάρχει επί του παρόντος επίσημη ημερομηνία κυκλοφορίας για το GPT-5, υπάρχουν ενδείξεις ότι θα μπορούσε να κυκλοφορήσει ήδη από το καλοκαίρι του 2024. Πολύ λίγες λεπτομέρειες είναι γνωστές για το μοντέλο αυτή τη στιγμή, αλλά πολλά πράγματα μπορούν να ειπωθούν γύρω του με αυτοπεποίθηση. Για ΕΠΙΒΕΒΑΙΩΣΗ:
- Το OpenAI έχει καταθέσει εμπορικό σήμα για το όνομα στο Γραφείο... Διπλώματα ευρεσιτεχνίας και εμπορικά σήματα Στις Ηνωμένες Πολιτείες.
- Αρκετά στελέχη του OpenAI έχουν συζητήσει ή υπαινιχθεί για τις πιθανές δυνατότητες του μοντέλου.
- Ο Sam Altman, Διευθύνων Σύμβουλος του OpenAI, ανέφερε το μοντέλο επανειλημμένα κατά τη διάρκεια μιας συνέντευξης στο YouTube Τον Μάρτιο του 2024 με τον Lex Friedman.
Όλα αυτά δείχνουν ένα συναρπαστικό γεγονός: το GPT-5 έρχεται! Ωστόσο, πολλά πράγματα είναι απλώς εικασίες σε αυτό το σημείο. Αλλά υπάρχουν ορισμένα χαρακτηριστικά που ελπίζουμε να δούμε και είμαστε αρκετά σίγουροι ότι θα δούμε σε αυτό το μοντέλο. Εδώ είναι μερικά από αυτά:
1. Υποστήριξη περισσότερων πολυμέσων

Μία από τις πιο συναρπαστικές βελτιώσεις στην οικογένεια μοντέλων τεχνητής νοημοσύνης GPT είναι η πολυτροπικότητα. Για λόγους σαφήνειας, η πολυτροπικότητα είναι η ικανότητα ενός μοντέλου τεχνητής νοημοσύνης να επεξεργάζεται περισσότερα από την απλή εισαγωγή κειμένου αλλά και άλλους τύπους εισαγωγής όπως εικόνες, ήχος και βίντεο. Η πολυτροπικότητα θα είναι ένα σημαντικό πρότυπο προόδου για την οικογένεια μοντέλων GPT στο μέλλον.
Με το GPT-4 να είναι ήδη ικανό στο χειρισμό της εισόδου και της εξόδου εικόνας, οι βελτιώσεις που καλύπτουν την επεξεργασία ήχου και βίντεο είναι η επόμενη σημαντική ανακάλυψη για το OpenAI και το GPT-5 είναι ένα καλό μέρος για να ξεκινήσετε. Η Google σημειώνει ήδη σοβαρή πρόοδο σε αυτόν τον τύπο πολυμέσων με ένα μοντέλο Gemini AI Το δικό της. Θα ήταν ασυνήθιστο για το OpenAI να μην απαντήσει. Αλλά, φυσικά, μην παίρνετε τα λόγια μας. Στο podcast του Ξεμπερδέψτε με [έκδοση PDF], ο Bill Gates ρώτησε τον Sam Altman, Διευθύνοντα Σύμβουλο της OpenAI, ποια σημαντικά ορόσημα αναμένει για τη σειρά GPT τα επόμενα δύο χρόνια. Η πρώτη του απάντηση; Ήταν επεξεργασία βίντεο.
Έτσι, για το GPT-5, αναμένουμε να μπορούμε να χειριζόμαστε βίντεο — να ανεβάζουμε βίντεο ως προτροπές, να δημιουργείτε βίντεο εν κινήσει, να επεξεργάζεστε βίντεο με προτροπές κειμένου, να εξάγετε κλιπ από βίντεο και να βρίσκετε συγκεκριμένες σκηνές από μεγάλα αρχεία βίντεο . Αναμένουμε να μπορούμε να κάνουμε παρόμοια πράγματα με αρχεία ήχου. Είναι μεγάλο το ερώτημα, ναι. Αλλά δεδομένου του πόσο γρήγορα εξελίσσεται η τεχνητή νοημοσύνη, είναι μια πολύ λογική προσδοκία.
2. Μεγαλύτερο και πιο αποτελεσματικό παράθυρο περιβάλλοντος

Παρά το γεγονός ότι είναι ένα από τα πιο προηγμένα μοντέλα AI στην αγορά, η οικογένεια μοντέλων τεχνητής νοημοσύνης GPT διαθέτει ένα από τα μικρότερα παράθυρα περιβάλλοντος. Για παράδειγμα, το Claude 3 της Anthropic διαθέτει ένα παράθυρο περιβάλλοντος με 200.000 μάρκες, ενώ το Gemini της Google μπορεί να χειριστεί ένα εκπληκτικό 1.000.000 μάρκες (128.000 για τυπική χρήση). Αντίθετα, το GPT-4 έχει ένα σχετικά μικρότερο παράθυρο περιβάλλοντος 128.000 διακριτικών, με περίπου 32.000 ή λιγότερα διακριτικά ρεαλιστικά διαθέσιμα για χρήση σε διεπαφές όπως το ChatGPT.
Με τα προηγμένα πολυμέσα να έρχονται στο προσκήνιο, η βελτίωση του παραθύρου περιβάλλοντος έχει καταστεί σχεδόν αναπόφευκτη. Μια αύξηση κατά δύο ή τέσσερις μπορεί να είναι αρκετή, αλλά ελπίζουμε να δούμε κάτι σαν συντελεστή δέκα. Αυτό θα επιτρέψει στο GPT-5 να επεξεργάζεται περισσότερες πληροφορίες με πιο αποτελεσματικό τρόπο. Τώρα, το μεγαλύτερο παράθυρο περιβάλλοντος δεν σημαίνει πάντα καλύτερο. Έτσι, αντί να αυξάνουμε απλώς το παράθυρο περιβάλλοντος, θα θέλαμε να δούμε μια αύξηση στην αποτελεσματικότητα της επεξεργασίας περιβάλλοντος.
Βλέπετε, ένα μοντέλο μπορεί να έχει ένα παράθυρο περιβάλλοντος 1.000.000 διακριτικών (χωρητικότητα περίπου 700.000 λέξεων), αλλά αποτυγχάνει να παράγει μια περιεκτική περίληψη όταν του ζητείται να συνοψίσει ένα βιβλίο 500.000 λέξεων, επειδή δεν μπορεί να επεξεργαστεί επαρκώς ολόκληρο το πλαίσιο παρά το γεγονός ότι έχει τη δυνατότητα να κάνει αυτό στη θεωρία. Ακριβώς επειδή μπορείτε να διαβάσετε ένα βιβλίο 500.000 λέξεων δεν σημαίνει ότι μπορείτε να θυμάστε ή να επεξεργαστείτε τα πάντα σε αυτό με λογική. Επαληθεύω Γιατί το παράθυρο περιβάλλοντος 1.5 εκατομμυρίου token στο Gemini XNUMX αλλάζει το παιχνίδι.
3. Διακομιστές μεσολάβησης GPT

Ίσως μια από τις πιο συναρπαστικές δυνατότητες για μια έκδοση GPT-5 είναι το ντεμπούτο των διακομιστών GPT. Ενώ ο όρος "game changer" πιθανότατα έχει χρησιμοποιηθεί υπερβολικά στην τεχνητή νοημοσύνη, η προσθήκη πρακτόρων GPT θα αλλάξει το παιχνίδι με όλη τη σημασία της λέξης. Πόσο μεγάλη όμως θα είναι αυτή η πιθανή αλλαγή;
Επί του παρόντος, μοντέλα τεχνητής νοημοσύνης όπως το GPT-4 μπορούν να σας βοηθήσουν να ολοκληρώσετε την εργασία. Μπορεί να γράψει ένα email, να κάνει ένα αστείο, να λύσει ένα μαθηματικό πρόβλημα ή να δημιουργήσει μια ανάρτηση ιστολογίου για εσάς. Ωστόσο, μπορεί να κάνει μόνο αυτή τη συγκεκριμένη εργασία και δεν μπορεί να ολοκληρώσει ένα σύνολο σχετικών εργασιών που μπορεί να είναι απαραίτητες για την ολοκλήρωση της εργασίας σας.
Ας υποθέσουμε ότι είστε προγραμματιστής ιστού. Ως μέρος της δουλειάς σας, θα πρέπει να κάνετε πολλά πράγματα: σχεδίαση, σύνταξη κώδικα, αντιμετώπιση προβλημάτων και πολλά άλλα. Προς το παρόν, μπορείτε να αναθέσετε μόνο ένα μέρος αυτών των εργασιών σε μοντέλα τεχνητής νοημοσύνης κάθε φορά. Ίσως θα μπορούσατε να ζητήσετε από ένα μοντέλο GPT-4 να γράψει κώδικα για τη διαμόρφωση της αρχικής σελίδας και, στη συνέχεια, να το κάνει για τη σελίδα επαφής, μετά για τη σελίδα σχετικά και ούτω καθεξής. Θα χρειαστεί να ολοκληρώνετε συχνά αυτές τις εργασίες. Υπάρχουν εργασίες που τα μοντέλα δεν μπορούν να ολοκληρώσουν.
Αυτή η επαναληπτική διαδικασία παρακίνησης μοντέλων τεχνητής νοημοσύνης να κάνουν συγκεκριμένες δευτερεύουσες εργασίες είναι χρονοβόρα και αναποτελεσματική. Σε αυτό το σενάριο, εσείς — ο προγραμματιστής ιστού — είστε ο ανθρώπινος πράκτορας που είναι υπεύθυνος για τον συντονισμό και την παρακίνηση του μοντέλου AI με μία εργασία τη φορά μέχρι να ολοκληρώσει ένα πλήρες σύνολο σχετικών εργασιών.
Οι πράκτορες GPT υπόσχονται εξειδικευμένα ρομπότ που συντονίζονται από το GPT-5 και, ελπίζουμε, είναι ικανά να αυτοκατευθύνονται και να χειρίζονται αυτόνομα όλα τα υποσύνολα μιας πολύπλοκης εργασίας. Εστιάστε στην «αυτοκίνητρα» και την «αυτονομία».
Έτσι, εάν το GPT-5 συνοδεύεται από πράκτορες GPT, μπορείτε να του ζητήσετε να "δημιουργήσει έναν ιστότοπο για το χαρτοφυλάκιο του Maxwell Timothy" αντί απλώς να "γράψει κώδικα για την αρχική σελίδα". Στη συνέχεια, το GPT-5 θα μπορούσε θεωρητικά να εκκινήσει αυτόνομες προτροπές καλώντας ειδικούς πράκτορες τεχνητής νοημοσύνης να χειριστούν τις διάφορες δευτερεύουσες εργασίες που απαιτούνται για τη δημιουργία ενός ιστότοπου. Μπορεί να ζητήσει από έναν GPT να περιηγηθεί στον ιστό για πληροφορίες σχετικά με τον Maxwell Timothy, έναν άλλο πράκτορα για να γράψει κώδικα για διαφορετικές σελίδες, έναν άλλο πράκτορα για τη δημιουργία και τη βελτίωση εικόνων, ακόμη και έναν άλλο πράκτορα AI για να δημοσιεύσει τον ιστότοπο, όλα αυτά χωρίς να απαιτείται συχνή ανθρώπινη παρέμβαση μέσω προτρέπει. Επαληθεύω Αξίζει να χρησιμοποιήσετε το Auto-GPT χωρίς GPT-4;
4. Λιγότερες παραισθήσεις
Παρόλο που το OpenAI έχει προχωρήσει πολύ στην αντιμετώπιση των παραισθήσεων στα μοντέλα AI, η πραγματική δοκιμασία του GPT-5 θα είναι η ικανότητά του να αντιμετωπίζει το επίμονο πρόβλημα των παραισθήσεων, το οποίο έχει εμποδίσει την ευρεία υιοθέτηση του AI λόγω των υψηλών κινδύνων που συνδέονται με αυτό. , ειδικά σε... Κρίσιμη ασφάλεια όπως η υγειονομική περίθαλψη, η αεροπορία και η ασφάλεια στον κυβερνοχώρο. Αυτοί είναι όλοι οι τομείς που θα ωφεληθούν σε μεγάλο βαθμό από την έντονη ενασχόληση με την τεχνητή νοημοσύνη, αλλά επί του παρόντος αποφεύγουν οποιαδήποτε σημαντική υιοθέτηση.
# Για το «πρόβλημα των ψευδαισθήσεων»
Πάντα παλεύω λίγο με το να με ρωτούν για το "πρόβλημα των ψευδαισθήσεων" στα LLM. Επειδή, από κάποια άποψη, οι παραισθήσεις είναι το μόνο που κάνουν οι LLM. Είναι ονειρικές μηχανές.
Κατευθύνουμε τα όνειρά τους με προτροπές. Οι προτροπές ξεκινούν το όνειρο και με βάση το…
— Andrej Karpathy (@karpathy) December 9, 2023
Για λόγους σαφήνειας, οι ψευδαισθήσεις σε αυτό το πλαίσιο αναφέρονται σε καταστάσεις στις οποίες ένα μοντέλο τεχνητής νοημοσύνης δημιουργεί και παρουσιάζει πληροφορίες που φαίνονται εύλογες αλλά είναι πλήρως κατασκευασμένες με υψηλό βαθμό εμπιστοσύνης. Επαληθεύω Μέθοδοι πρόληψης παραισθήσεων σε μοντέλα τεχνητής νοημοσύνης.
Φανταστείτε ένα σενάριο όπου το GPT-4 ενσωματώνεται σε ένα διαγνωστικό σύστημα για την ανάλυση των συμπτωμάτων των ασθενών και των ιατρικών εκθέσεων. Οι ψευδαισθήσεις μπορεί να οδηγήσουν την τεχνητή νοημοσύνη να παρέχει με σιγουριά μια εσφαλμένη διάγνωση ή να συστήσει μια δυνητικά επικίνδυνη πορεία θεραπείας που βασίζεται σε φανταστικά γεγονότα και ψευδή λογική. Οι συνέπειες ενός τέτοιου λάθους στον ιατρικό τομέα μπορεί να είναι καταστροφικές.
Παρόμοιες επιφυλάξεις ισχύουν και για άλλους τομείς που προκαλούν μεγάλη ανησυχία, όπως η αεροπορία, η πυρηνική ενέργεια, οι θαλάσσιες επιχειρήσεις και η ασφάλεια στον κυβερνοχώρο. Δεν περιμένουμε ότι το GPT-5 θα λύσει πλήρως το πρόβλημα των παραισθήσεων, αλλά περιμένουμε να μειώσει σημαντικά την πιθανότητα εμφάνισης τέτοιων περιστατικών.
Καθώς περιμένουμε με ανυπομονησία την επίσημη κυκλοφορία αυτού του πολυαναμενόμενου μοντέλου AI, ένα πράγμα είναι σίγουρο: το GPT-5 έχει τη δυνατότητα να επαναπροσδιορίσει τα όρια του τι είναι δυνατό με την τεχνητή νοημοσύνη, προαναγγέλλοντας μια νέα εποχή συνεργασίας και καινοτομίας ανθρώπου-μηχανής. Τώρα μπορείτε να δείτε Οι καλύτερες έξυπνες γεννήτριες αξιώσεων για οποιαδήποτε μορφή που λειτουργεί με AI.










