Η Google παρουσιάζει την τέλεια απομίμηση ανθρώπινης φωνής από Τεχνητή Νοημοσύνη

Η Google μόλις αποκάλυψε την πρώτη αλάνθαστη εξομοίωση της ανθρώπινης φωνής από το νέο της σύστημα Τεχνητής Νοημοσύνης.

Γιάννης Παπαϊωάννου 27.12.2017 | 15:40

27.12.2017 | 15:40

Πριν ένα χρόνο το σύστημα WaveNet της Google είχε φέρει την τεχνητή και μηχανική ομιλία σε πρωτοποριακά επίπεδα. Λίγο πριν κλείσει το 2017 η Google ανακοίνωσε ένα νέο σύστημα που μετατρέπει κείμενο σε ομιλία με μια τεχνητή φωνή που πολύ δύσκολα ξεχωρίζει από ανθρώπινη.

Η Google πρωτοπορεί με ένα ολοκαίνουργιο σύστημα μετατροπής κειμένου σε ομιλία το οποίο ονομάζει Tacotron 2 και λειτουργεί με εκπληκτική ακρίβεια, παρέχοντας φωνητικές αφηγήσεις που δεν διακρίνονται από τη φωνή ενός πραγματικού ανθρώπου. Και δεν για υπερβολή: Το Tacotron 2 τεχνολογία δεύτερης γενιάς και αποτελείται από δύο βαθιά νευρωνικά δίκτυα, ένα που μετατρέπει το κείμενο σε ένα ειδικό φασματογράφημα (όπως αυτό που βλέπετε στην εικόνα παρακάτω) και ένα δεύτερο, το WaveNet, που διαβάζει αυτό το γράφημα και το ερμηνεύει σε μια πραγματική φωνή.

Το σύστημα μέχρι σήμερα είναι εκπαιδευμένο να εργάζεται μόνο στα αγγλικά με τη μία θηλυκή φωνή που μπορείτε να ακούσετε στα δείγματα που βρίσκονται στο σύνδεσμο παρακάτω. Το εκπληκτικό όμως δεν είναι ότι μπορεί να διαβάσει με τέλεια προφορά (η οποία δεν ξεχωρίζει από την ανθρώπινη), αλλά ότι είναι σε θέση να τονίζει τις αποχρώσεις σε μια πρόταση. Επίσης, αν μια συγκεκριμένη λέξη είναι γραμμένη με κεφαλαία, θα της προσθέσει μια έμφαση στον τρόπο απόδοσής της, ενώ εάν προσπαθήσει να διαβάζει μια πρόταση που έχει γραφτεί με μοντέρνο τρόπο, θα την καταλάβει και θα τη διαβάσει, αφού το σύστημα αυτό είναι σε θέση να αντιμετωπίσει και μια μικρή (ακόμα) ποσότητα τυπογραφικών λαθών ή μοντέρνας έκφρασης.

Το νέο σύστημα, με κανένα τρόπο, δεν ακούγεται ρομποτικό ή ψηφιοποιημένο και μπορεί να πει τη σωστή προφορά δύο ίδιων γραμμένων λέξεων ανάλογα με τη σημασία τους στην πρόταση.

Μια πλήρης περιγραφή του νέου συστήματος της Google μπορεί να βρεθεί στην εργασία «Natural TTS Synthesis by Conditioning WaveNet on Mel Spectrogram Predictions.» Χρησιμοποιώντας ένα μοντέλο ακολουθιών το Tacotron 2 χαρτογραφεί την ακολουθία των γραμμάτων σε μια σειρά χαρακτηριστικών που κωδικοποιούν τον ήχο. Όλα αυτά τα χαρακτηριστικά, δημιουργούν ένα 80-διάστατο φασματογράφημα ήχου, χωρισμένο σε καρέ που υπολογίζονται κάθε 12,5 χιλιοστά του δευτερολέπτου, τα οποία καταγράφουν όχι μόνο την προφορά λέξεων αλλά και διάφορες λεπτές αποχρώσεις της ανθρώπινης ομιλίας, συμπεριλαμβανομένου του όγκου, της ταχύτητας και του ήχου. Τέλος, αυτά τα χαρακτηριστικά μετατρέπονται σε μια κυματομορφή 24 kHz χρησιμοποιώντας την αρχιτεκτονική του συστήματος WaveNet.

Σε αντίθεση με ορισμένες βασικές έρευνες AI που κάνει η εταιρεία, αυτή η τεχνολογία είναι άμεσα χρήσιμη για την Google. Το WaveNet, που ανακοινώθηκε για πρώτη φορά το 2016, χρησιμοποιείται τώρα για τη δημιουργία της φωνής στο Google Assistant. Μόλις προετοιμαστεί για παραγωγή, το Tacotron 2 θα μπορούσε να είναι μια ακόμη πιο ισχυρή προσθήκη στην υπηρεσία.

Ωστόσο, το σύστημα έχει «εκπαιδευτεί» για να μιμείται μόνο τη συγκεκριμένη θηλυκή φωνή. Για να μιλήσει σαν άνδρας ή κάποια άλλη γυναίκα, η Google θα πρέπει να εκπαιδεύσει ξανά το σύστημα απο την αρχή.

Εδώ μπορείτε να ακούσετε τα φανταστικά δείγματα της νέας τεχνητής φωνής της Google σε σύγκριση με τα πραγματικά δείγματα πάνω στα οποία εκπαιδεύτηκε.

Τech & Science

ΔΕΙΤΕ ΑΚΟΜΑ

Τech & Science / Κλιματική αλλαγή και ρύπανση αυξάνουν τον κίνδυνο εγκεφαλικού επεισοδίου

Η κλιματική αλλαγή και η ατμοσφαιρική ρύπανση ενδέχεται να συνδέονται με τον κίνδυνο εγκεφαλικού επεισοδίου, σύμφωνα με τον Παγκόσμιο Οργανισμό Εγκεφαλικού

Η Google παρουσιάζει την τέλεια απομίμηση ανθρώπινης φωνής από Τεχνητή Νοημοσύνη

Tags

ΕΓΓΡΑΦΕΙΤΕ ΣΤΟ NEWSLETTER ΜΑΣ

ΔΙΑΒΑΖΟΝΤΑΙ ΤΩΡΑ

Gen Z: Εκπλήσσει το δεύτερο ταχύτερα αναπτυσσόμενο χόμπι των νέων, σύμφωνα με έρευνα

Είναι ο καφές «όπλο» κατά της γήρανσης; - Νέα μελέτη απαντά

Αγγλία: Κηδεύτηκε βρέφος που βρέθηκε κάτω από το πάτωμα σπιτιού έπειτα από έναν αιώνα

Πώς κατάφερε ο Banksy να τοποθετήσει ένα άγαλμα στο κέντρο του Λονδίνου;

Καιρός: Πότε επιστρέφει η άνοιξη

Αίγυπτος: Νεκρός Γερμανός τουρίστας - Φίδι μπήκε στο παντελόνι του και τον δάγκωσε

ΔΕΙΤΕ ΑΚΟΜΑ

Τech & Science / Κλιματική αλλαγή και ρύπανση αυξάνουν τον κίνδυνο εγκεφαλικού επεισοδίου

Τech & Science / Ψωμί: Αποκαλυπτική έρευνα ανατρέπει τα δεδομένα για το σιτάρι

Τech & Science / Gen Z: Εκπλήσσει το δεύτερο ταχύτερα αναπτυσσόμενο χόμπι των νέων, σύμφωνα με έρευνα

Τech & Science / Είναι ο καφές «όπλο» κατά της γήρανσης; - Νέα μελέτη απαντά

Τech & Science / «Make Pluto a Planet again» είπε ο επικεφαλής της NASA: Ανοίγει ξανά η συζήτηση για τον Πλούτωνα

Τech & Science / YouTube: Μια πολυαναμενόμενη λειτουργία γίνεται διαθέσιμη σε όλους

Τech & Science / Οι ΗΠΑ δοκιμάζουν MDMA για τη θεραπεία μετατραυματικού στρες σε εν ενεργεία στρατιώτες

Τech & Science / Επιστρέφει η «μπλε αντιλόπη»; Η εταιρεία που επανέφερε τον ανταρόλυκο στοχεύει σε νέο είδος

Τech & Science / Το Spotify εισάγει σήμα επαλήθευσης για να διακρίνονται οι πραγματικοί καλλιτέχνες από τα AI προφίλ

Τech & Science / Από το BuddhaBot μέχρι τον AI Jesus: Η νέα αγορά όπου η πίστη χρεώνεται με το λεπτό

Τech & Science / Γιατί το να κρατάμε κακία μπορεί να βλάπτει την υγεία μας

Τech & Science / Πανσέληνος Μαΐου: Έρχεται το «Φεγγάρι των Λουλουδιών» - Τι ώρα θα είναι ορατό στην Ελλάδα

Τech & Science / Στιγμή - ορόσημο για την αντιμετώπιση του καρκίνου στο πάγκρεας: AI μπορεί να τον εντοπίζει έως και 3 χρόνια πριν τη διάγνωση

Τech & Science / Δύο νέες μελέτες αποκαλύπτουν τον «χαμένο χάρτη» της όσφρησης

Τech & Science / Οξφόρδη: Όσο πιο «φιλικά» γίνονται τα ΑΙ chatbots, τόσο αυξάνονται τα λάθη

Τech & Science / Το Google Translate θέλει πλέον να διορθώνει και την προφορά σου

Τech & Science / ΕΕ: Η Meta παραβιάζει τη νομοθεσία επιτρέποντας πρόσβαση σε παιδιά κάτω των 13

Τech & Science / «Βλέπω ό,τι χειρότερο έχει γεννήσει η ανθρωπότητα»

Τech & Science / Καρκίνος: Οι 11 μορφές που αυξάνονται στους νέους, συμφωνα με το Imperial College και το ICR

Τech & Science / Ιαπωνία: Ρομπότ «πιάνουν» δουλειά σε αεροδρόμιο λόγω έλλειψης προσωπικού

σχόλια