Δύο νέα μοντέλα για πιο ομαλή φωνητική αλληλεπίδραση
Η OpenAI ανακοίνωσε το GPT-Live, ένα νέο φωνητικό μοντέλο που σχεδιάστηκε για πιο φυσικές συνομιλίες με το ChatGPT. Το βασικό του χαρακτηριστικό είναι ότι μπορεί να ακούει τον χρήστη και να μιλά ταυτόχρονα, αντί να περιμένει διαδοχικά την ολοκλήρωση κάθε βήματος της συνομιλίας.
Η δυνατότητα αυτή βασίζεται σε full-duplex αρχιτεκτονική, στοιχείο που αλλάζει τον τρόπο με τον οποίο εξελίσσεται ένας φωνητικός διάλογος με σύστημα τεχνητής νοημοσύνης. Ο στόχος είναι η εμπειρία να μοιάζει πιο κοντά σε ανθρώπινη συνομιλία και λιγότερο σε εναλλαγή εντολών και απαντήσεων.
Τι αλλάζει στις πιο σύνθετες ερωτήσεις
Σύμφωνα με όσα έγιναν γνωστά, όταν μια ερώτηση χρειάζεται περισσότερο χρόνο επεξεργασίας ή αναζήτηση στον ιστό, το GPT-Live μπορεί να συνεχίζει να μιλά ενώ επεξεργάζεται το αίτημα στο παρασκήνιο. Αυτό σημαίνει ότι η φωνητική ροή δεν διακόπτεται αναγκαστικά μέχρι να ολοκληρωθεί η απάντηση.
Η συγκεκριμένη προσέγγιση επιχειρεί να αντιμετωπίσει ένα από τα βασικά μειονεκτήματα που είχαν έως τώρα οι φωνητικές συνομιλίες με ΑΙ: την αίσθηση παύσης και καθυστέρησης ανάμεσα στις φράσεις του χρήστη και στις απαντήσεις του μοντέλου.
Διαθεσιμότητα
Η OpenAI προχωρά ήδη στη διάθεση των GPT-Live-1 και GPT-Live-mini. Τα νέα μοντέλα θα είναι διαθέσιμα τόσο στις εφαρμογές του ChatGPT όσο και μέσω web.















