Η τεχνολογίες τεχνητής νοημοσύνης εξελίσσεται συνεχώς. Μπορεί πολλοί άνθρωποι χρησιμοποιούν AI για να ολοκληρώνουν τις εργασίες τους πιο εύκολα, αυτή η τεχνολογία μπορεί να προσφέρει πολύ περισσότερα. Η Google προσπαθεί εδώ και χρόνια να φτάσει τα όρια της τεχνητής νοημοσύνης και να ξεκλειδώσει όλο το φάσμα των δυνατοτήτων της. Η τελευταία εξέλιξη αυτής της προσπάθειας είναι το AudioPaLM. Πρόκειται για ένα νέο γλωσσικό μοντέλο που μπορεί να ακούσει, να μιλήσει, και να μεταφράσει με πρωτοφανή ακρίβεια.

Πρόκειται για μια πολυτροπική αρχιτεκτονική που συνδυάζει τα πλεονεκτήματα δύο υφιστάμενων μοντέλων, των PaLM-2 και AudioLM. Το PaLM-2 είναι ένα γλωσσικό μοντέλο βασισμένο σε κείμενο που είναι καλό στην κατανόηση της γλωσσικής γνώσης συγκεκριμένων κειμένων. Από την άλλη, το AudioLM είναι εξαιρετικό στη διατήρηση παραγλωσσικών πληροφοριών όπως η ταυτότητα του ομιλητή και ο τόνος.

Συνδυάζοντας αυτά τα δύο μοντέλα, το AudioPaLM εκμεταλλεύεται τη γλωσσική εμπειρογνωμοσύνη του PaLM-2 και τη διατήρηση των παραγλωσσικών πληροφοριών του AudioLM, οδηγώντας σε μια πιο εμπεριστατωμένη κατανόηση και δημιουργία τόσο κειμένου όσο και ομιλίας.

Αυτό το γλωσσικό μοντέλο κάνει χρήση ενός κοινού λεξιλογίου που μπορεί να αναπαραστήσει τόσο ομιλία όσο και κείμενο, με έναν περιορισμένο αριθμό διακριτών tokens. Αυτό επιτρέπει την ενοποίηση εργασιών όπως η αναγνώριση ομιλίας, η σύνθεση κειμένου από ομιλία, και η μετάφραση ομιλίας σε ομιλία, και τη δημιουργία μιας ενιαίας αρχιτεκτονικής και διαδικασίας εκπαίδευσης.

Το AudioPaLM έχει αποδειχθεί ότι ξεπερνά τα υπάρχοντα συστήματα στη μετάφραση ομιλίας. Επιπλέον, μπορεί να εκτελέσει μετάφραση ομιλίας σε κείμενο για γλωσσικούς συνδυασμούς που δεν έχει συναντήσει ποτέ πριν. Επίσης, μπορεί να μεταφέρει φωνές μεταξύ γλωσσών με βάση σύντομες προφορικές οδηγίες και μπορεί να συλλάβει και να αναπαράγει ξεχωριστές φωνές σε διαφορετικές γλώσσες.

Πηγή: MarktechPost.com

Αφήστε ένα Σχόλιο

Το e-mail σας δεν δημοσιεύεται. Τα υποχρεωτικά πεδία σημειώνονται με *


Διαβάστε επίσης

Τα έσοδα του Darknet μειώθηκαν μετά το κλείσιμο της Hydra

Το 2022, η darknet αγορά Hydra έκλεισε, οδηγώντας σε μια μαζική αλλαγή στον κόσμο των drugs και άλλων παράνομων αγαθών. Η εταιρεία ανάλυσης blockchain Chainalysis ανέφερε ότι με βάση τα δεδομένα blockchain, πολλοί darknet vendors που χρησιμοποιούσαν την Hydra μεταπήδησαν στην OMG!OMG!, μια εναλλακτική αγορά.

H OpenAI ανακοινώνει το SearchGPT: Η νέα ΑΙ μηχανή αναζήτησης

Το SearchGPT είναι η νέα μηχανή αναζήτησης της OpenAI, που έρχεται να ανταγωνιστεί το Google Search.

To Reddit φέρνει πιο αυστηρή επαλήθευση των χρηστών εξαιτίας των bots

Το Reddit σχεδιάζει να αυστηροποιήσει την επαλήθευση χρηστών για να αποδείξει την ανθρώπινη φύση τους ως απάντηση στο πρόβλημα των bot.