suchen
HeimTechnologie-PeripheriegeräteKIMicrosoft kündigt das Text-to-Speech-Avatar-KI-Tool an, mit dem virtuelle digitale 3D-Menschen erstellt werden können

Microsoft hat auf der Ignite-Konferenz ein KI-Tool namens „Azure AI Speech Text to Speech (TTS) Avatar“ veröffentlicht, das angeblich realistische virtuelle Charaktere generieren kann. Dieses Tool ist jetzt zur Vorschau für die Öffentlichkeit zugänglich

微软公布 Text To Speech Avatar AI工具,可制作虚拟3D数字人

Microsoft sagte, dass Benutzer mithilfe des TTS-Avatars (Text-to-Speech) von Azure AI Speech einen virtuellen Avatar erstellen können, der auf „Texteingabe und Sprachinhalt“ basiert, und ihn mit Fototraining von realen Personen kombinieren können, um einen „auf realen interaktiven Chat-Robotern basierenden“ zu erstellen Menschen“ „, die in Unternehmensmarketing-, Geschäfts- oder Kundendienstszenarien eingesetzt werden können.

Es wird berichtet, dass der Text-to-Speech (TTS)-Avatar von Azure AI Speech hauptsächlich aus drei Modulen besteht, nämlich Textanalysator, TTS-Sprachsynthesizer und TTS-Virtual-Avatar-Synthesizer

Der Textanalysator analysiert zunächst den vom Benutzer eingegebenen Textinhalt und generiert eine Phonemsequenz. Anschließend wird das TTS-Sprachmodell im TTS-Soundsynthesizer die akustischen Eigenschaften des vom Benutzer eingegebenen Texts vorhersagen und dann den Sound synthetisieren. Schließlich wird das Klangsynthesemodell Avatar des neuronalen Netzwerks das Bild der Lippenform des Charakters basierend auf den oben genannten akustischen Eigenschaften vorhersagen und so letztendlich das Bild des virtuellen Avatars bilden

Microsoft erklärte, dass die herkömmliche Avatar-Produktion zeitaufwändig und arbeitsintensiv sei, die Einrichtung einer speziellen Aufnahmeumgebung erfordere und der Postproduktionsprozess der Aufnahme und Bearbeitung ebenfalls recht kostspielig sei. Derzeit wird der neueste Avatar-Dienst Azure AI Speech (TTS) von Microsoft verwendet. Nach der erstmaligen Einrichtung des Modells können Benutzer verschiedene Produkteinführungen, interaktive Videos usw. erstellen, indem sie einfach Text eingeben. Zusammen mit dem Microsoft Azure OpenAI Service und den TTS-Funktionen des neuronalen Netzwerks kann es auch ein natürlicheres interaktives Erlebnis bieten.

微软公布 Text To Speech Avatar AI工具,可制作虚拟3D数字人

微软公布 Text To Speech Avatar AI工具,可制作虚拟3D数字人

IT House berichtete, dass Microsoft ein Beispiel dafür gegeben hat, dass Benutzer den Azure AI Speech TTS-Avatar verwenden können, um verschiedene Videoinhalte stapelweise zu produzieren, wie zum Beispiel Videos zur Unternehmenskultur, Produkteinführungen oder den digitalen Avatar des CEO auf einer Konferenz. Darüber hinaus können Sie auch virtuelle Live-Übertragungen digitaler Menschen, Chat-Roboter, Geschäftsroboter und KI-Lehrer für den Online-Unterricht usw. erstellen.

微软公布 Text To Speech Avatar AI工具,可制作虚拟3D数字人

Microsoft gab bekannt, dass Azure AI Speech Synthesis (TTS)-Avatare jetzt für Azure-Abonnenten verfügbar sind und mehrere Sprachen unterstützen. Benutzer können ihren gewünschten Charakter aus voreingestellten Avatar-Optionen auswählen oder ihren Avatar anpassen

微软公布 Text To Speech Avatar AI工具,可制作虚拟3D数字人

Wenn Benutzer ihren eigenen virtuellen Avatar anpassen möchten, müssen sie eine Reihe von Charaktervideoclips hochladen. Die Azure-Plattform verarbeitet diese Videos dann online, um einen virtuellen Avatar zu generieren. Der Charakter selbst ist von der Tonquelle getrennt. Benutzer können die offizielle Standard-Tonquelle auswählen oder ihre eigene Trainings-Tonquelle hochladen.

Das obige ist der detaillierte Inhalt vonMicrosoft kündigt das Text-to-Speech-Avatar-KI-Tool an, mit dem virtuelle digitale 3D-Menschen erstellt werden können. Für weitere Informationen folgen Sie bitte anderen verwandten Artikeln auf der PHP chinesischen Website!

Stellungnahme
Dieser Artikel ist reproduziert unter:搜狐. Bei Verstößen wenden Sie sich bitte an admin@php.cn löschen
Was ist Denkdiagramm in der schnellen IngenieurwesenWas ist Denkdiagramm in der schnellen IngenieurwesenApr 13, 2025 am 11:53 AM

Einführung In prompt Engineering bezieht sich „Graph of Denk“ auf einen neuartigen Ansatz, der die Grafik Theorie verwendet, um die Argumentationsprozess von AI zu strukturieren und zu leiten. Im Gegensatz zu herkömmlichen Methoden, bei denen es sich häufig um lineare handelt

Optimieren Sie die E -Mail -Marketing Ihres Unternehmens mit Genai -AgentenOptimieren Sie die E -Mail -Marketing Ihres Unternehmens mit Genai -AgentenApr 13, 2025 am 11:44 AM

Einführung Glückwunsch! Sie führen ein erfolgreiches Geschäft. Über Ihre Webseiten, Social -Media -Kampagnen, Webinare, Konferenzen, kostenlose Ressourcen und andere Quellen sammeln Sie täglich 5000 E -Mail -IDs. Der nächste offensichtliche Schritt ist

Echtzeit-App-Leistungsüberwachung mit Apache PinotEchtzeit-App-Leistungsüberwachung mit Apache PinotApr 13, 2025 am 11:40 AM

Einführung In der heutigen schnelllebigen Softwareentwicklungsumgebung ist die Gewährleistung einer optimalen Anwendungsleistung von entscheidender Bedeutung. Die Überwachung von Echtzeitmetriken wie Antwortzeiten, Fehlerraten und Ressourcenauslastung kann die Hauptstufe unterstützen

Chatgpt trifft 1 Milliarde Benutzer? 'In nur wenigen Wochen verdoppelt', sagt OpenAI -CEOChatgpt trifft 1 Milliarde Benutzer? 'In nur wenigen Wochen verdoppelt', sagt OpenAI -CEOApr 13, 2025 am 11:23 AM

"Wie viele Benutzer haben Sie?" er stapte. "Ich denke, das letzte Mal, als wir sagten, wächst 500 Millionen wöchentliche Wirkstoffe, und es wächst sehr schnell", antwortete Altman. "Du hast mir gesagt, dass es sich in nur wenigen Wochen verdoppelt hat", fuhr Anderson fort. „Ich habe das Privat gesagt

Pixtral -12b: Mistral AIs erstes multimodales Modell - Analytics VidhyaPixtral -12b: Mistral AIs erstes multimodales Modell - Analytics VidhyaApr 13, 2025 am 11:20 AM

Einführung Mistral hat sein erstes multimodales Modell veröffentlicht, nämlich den Pixtral-12b-2409. Dieses Modell basiert auf dem 12 -Milliarden -Parameter von Mistral, NEMO 12b. Was unterscheidet dieses Modell? Es kann jetzt sowohl Bilder als auch Tex aufnehmen

Agentenrahmen für generative KI -Anwendungen - Analytics VidhyaAgentenrahmen für generative KI -Anwendungen - Analytics VidhyaApr 13, 2025 am 11:13 AM

Stellen Sie sich vor, Sie hätten einen AS-Assistenten mit KI, der nicht nur auf Ihre Abfragen reagiert, sondern auch autonom Informationen sammelt, Aufgaben ausführt und sogar mehrere Arten von Daten ausführt-Text, Bilder und Code. Klingt futuristisch? In diesem a

Anwendungen der Generativen KI im FinanzsektorAnwendungen der Generativen KI im FinanzsektorApr 13, 2025 am 11:12 AM

Einführung Die Finanzbranche ist der Eckpfeiler der Entwicklung eines Landes, da sie das Wirtschaftswachstum fördert, indem sie effiziente Transaktionen und Kreditverfügbarkeit erleichtert. Die Leichtigkeit, mit der Transaktionen auftreten und Krediten auftreten

Leitfaden für Online-Lernen und passiv-aggressive AlgorithmenLeitfaden für Online-Lernen und passiv-aggressive AlgorithmenApr 13, 2025 am 11:09 AM

Einführung Daten werden mit beispielloser Geschwindigkeit aus Quellen wie Social Media, Finanztransaktionen und E-Commerce-Plattformen generiert. Der Umgang mit diesem kontinuierlichen Informationsstrom ist eine Herausforderung, aber sie bietet eine

See all articles

Heiße KI -Werkzeuge

Undresser.AI Undress

Undresser.AI Undress

KI-gestützte App zum Erstellen realistischer Aktfotos

AI Clothes Remover

AI Clothes Remover

Online-KI-Tool zum Entfernen von Kleidung aus Fotos.

Undress AI Tool

Undress AI Tool

Ausziehbilder kostenlos

Clothoff.io

Clothoff.io

KI-Kleiderentferner

AI Hentai Generator

AI Hentai Generator

Erstellen Sie kostenlos Ai Hentai.

Heißer Artikel

R.E.P.O. Energiekristalle erklärten und was sie tun (gelber Kristall)
3 Wochen vorBy尊渡假赌尊渡假赌尊渡假赌
R.E.P.O. Beste grafische Einstellungen
3 Wochen vorBy尊渡假赌尊渡假赌尊渡假赌
R.E.P.O. So reparieren Sie Audio, wenn Sie niemanden hören können
3 Wochen vorBy尊渡假赌尊渡假赌尊渡假赌
WWE 2K25: Wie man alles in Myrise freischaltet
4 Wochen vorBy尊渡假赌尊渡假赌尊渡假赌

Heiße Werkzeuge

SAP NetWeaver Server-Adapter für Eclipse

SAP NetWeaver Server-Adapter für Eclipse

Integrieren Sie Eclipse mit dem SAP NetWeaver-Anwendungsserver.

DVWA

DVWA

Damn Vulnerable Web App (DVWA) ist eine PHP/MySQL-Webanwendung, die sehr anfällig ist. Seine Hauptziele bestehen darin, Sicherheitsexperten dabei zu helfen, ihre Fähigkeiten und Tools in einem rechtlichen Umfeld zu testen, Webentwicklern dabei zu helfen, den Prozess der Sicherung von Webanwendungen besser zu verstehen, und Lehrern/Schülern dabei zu helfen, in einer Unterrichtsumgebung Webanwendungen zu lehren/lernen Sicherheit. Das Ziel von DVWA besteht darin, einige der häufigsten Web-Schwachstellen über eine einfache und unkomplizierte Benutzeroberfläche mit unterschiedlichen Schwierigkeitsgraden zu üben. Bitte beachten Sie, dass diese Software

SublimeText3 Englische Version

SublimeText3 Englische Version

Empfohlen: Win-Version, unterstützt Code-Eingabeaufforderungen!

Notepad++7.3.1

Notepad++7.3.1

Einfach zu bedienender und kostenloser Code-Editor

Herunterladen der Mac-Version des Atom-Editors

Herunterladen der Mac-Version des Atom-Editors

Der beliebteste Open-Source-Editor