suchen
HeimTechnologie-PeripheriegeräteKIMicrosoft kündigt das Text-to-Speech-Avatar-KI-Tool an, mit dem virtuelle digitale 3D-Menschen erstellt werden können

Microsoft hat auf der Ignite-Konferenz ein KI-Tool namens „Azure AI Speech Text to Speech (TTS) Avatar“ veröffentlicht, das angeblich realistische virtuelle Charaktere generieren kann. Dieses Tool ist jetzt zur Vorschau für die Öffentlichkeit zugänglich

微软公布 Text To Speech Avatar AI工具,可制作虚拟3D数字人

Microsoft sagte, dass Benutzer mithilfe des TTS-Avatars (Text-to-Speech) von Azure AI Speech einen virtuellen Avatar erstellen können, der auf „Texteingabe und Sprachinhalt“ basiert, und ihn mit Fototraining von realen Personen kombinieren können, um einen „auf realen interaktiven Chat-Robotern basierenden“ zu erstellen Menschen“ „, die in Unternehmensmarketing-, Geschäfts- oder Kundendienstszenarien eingesetzt werden können.

Es wird berichtet, dass der Text-to-Speech (TTS)-Avatar von Azure AI Speech hauptsächlich aus drei Modulen besteht, nämlich Textanalysator, TTS-Sprachsynthesizer und TTS-Virtual-Avatar-Synthesizer

Der Textanalysator analysiert zunächst den vom Benutzer eingegebenen Textinhalt und generiert eine Phonemsequenz. Anschließend wird das TTS-Sprachmodell im TTS-Soundsynthesizer die akustischen Eigenschaften des vom Benutzer eingegebenen Texts vorhersagen und dann den Sound synthetisieren. Schließlich wird das Klangsynthesemodell Avatar des neuronalen Netzwerks das Bild der Lippenform des Charakters basierend auf den oben genannten akustischen Eigenschaften vorhersagen und so letztendlich das Bild des virtuellen Avatars bilden

Microsoft erklärte, dass die herkömmliche Avatar-Produktion zeitaufwändig und arbeitsintensiv sei, die Einrichtung einer speziellen Aufnahmeumgebung erfordere und der Postproduktionsprozess der Aufnahme und Bearbeitung ebenfalls recht kostspielig sei. Derzeit wird der neueste Avatar-Dienst Azure AI Speech (TTS) von Microsoft verwendet. Nach der erstmaligen Einrichtung des Modells können Benutzer verschiedene Produkteinführungen, interaktive Videos usw. erstellen, indem sie einfach Text eingeben. Zusammen mit dem Microsoft Azure OpenAI Service und den TTS-Funktionen des neuronalen Netzwerks kann es auch ein natürlicheres interaktives Erlebnis bieten.

微软公布 Text To Speech Avatar AI工具,可制作虚拟3D数字人

微软公布 Text To Speech Avatar AI工具,可制作虚拟3D数字人

IT House berichtete, dass Microsoft ein Beispiel dafür gegeben hat, dass Benutzer den Azure AI Speech TTS-Avatar verwenden können, um verschiedene Videoinhalte stapelweise zu produzieren, wie zum Beispiel Videos zur Unternehmenskultur, Produkteinführungen oder den digitalen Avatar des CEO auf einer Konferenz. Darüber hinaus können Sie auch virtuelle Live-Übertragungen digitaler Menschen, Chat-Roboter, Geschäftsroboter und KI-Lehrer für den Online-Unterricht usw. erstellen.

微软公布 Text To Speech Avatar AI工具,可制作虚拟3D数字人

Microsoft gab bekannt, dass Azure AI Speech Synthesis (TTS)-Avatare jetzt für Azure-Abonnenten verfügbar sind und mehrere Sprachen unterstützen. Benutzer können ihren gewünschten Charakter aus voreingestellten Avatar-Optionen auswählen oder ihren Avatar anpassen

微软公布 Text To Speech Avatar AI工具,可制作虚拟3D数字人

Wenn Benutzer ihren eigenen virtuellen Avatar anpassen möchten, müssen sie eine Reihe von Charaktervideoclips hochladen. Die Azure-Plattform verarbeitet diese Videos dann online, um einen virtuellen Avatar zu generieren. Der Charakter selbst ist von der Tonquelle getrennt. Benutzer können die offizielle Standard-Tonquelle auswählen oder ihre eigene Trainings-Tonquelle hochladen.

Das obige ist der detaillierte Inhalt vonMicrosoft kündigt das Text-to-Speech-Avatar-KI-Tool an, mit dem virtuelle digitale 3D-Menschen erstellt werden können. Für weitere Informationen folgen Sie bitte anderen verwandten Artikeln auf der PHP chinesischen Website!

Stellungnahme
Dieser Artikel ist reproduziert unter:搜狐. Bei Verstößen wenden Sie sich bitte an admin@php.cn löschen
10 generative AI -Codierungsweiterungen im VS -Code, die Sie untersuchen müssen10 generative AI -Codierungsweiterungen im VS -Code, die Sie untersuchen müssenApr 13, 2025 am 01:14 AM

Hey da, codieren Ninja! Welche Codierungsaufgaben haben Sie für den Tag geplant? Bevor Sie weiter in diesen Blog eintauchen, möchte ich, dass Sie über all Ihre Coding-Leiden nachdenken-die Auflistung auflisten diese auf. Erledigt? - Lassen Sie ’

Kochen innovation: Wie künstliche Intelligenz den Lebensmittelservice verändertKochen innovation: Wie künstliche Intelligenz den Lebensmittelservice verändertApr 12, 2025 pm 12:09 PM

KI verstärken die Zubereitung der Lebensmittel KI -Systeme werden während der Nahten immer noch in der Zubereitung von Nahrungsmitteln eingesetzt. KI-gesteuerte Roboter werden in Küchen verwendet, um Aufgaben zur Zubereitung von Lebensmitteln zu automatisieren, z.

Umfassende Anleitung zu Python -Namespaces und variablen ScopesUmfassende Anleitung zu Python -Namespaces und variablen ScopesApr 12, 2025 pm 12:00 PM

Einführung Das Verständnis der Namespaces, Scopes und des Verhaltens von Variablen in Python -Funktionen ist entscheidend, um effizient zu schreiben und Laufzeitfehler oder Ausnahmen zu vermeiden. In diesem Artikel werden wir uns mit verschiedenen ASP befassen

Ein umfassender Leitfaden zu Vision Language Models (VLMs)Ein umfassender Leitfaden zu Vision Language Models (VLMs)Apr 12, 2025 am 11:58 AM

Einführung Stellen Sie sich vor, Sie gehen durch eine Kunstgalerie, umgeben von lebhaften Gemälden und Skulpturen. Was wäre, wenn Sie jedem Stück eine Frage stellen und eine sinnvolle Antwort erhalten könnten? Sie könnten fragen: „Welche Geschichte erzählst du?

MediaTek steigert die Premium -Aufstellung mit Kompanio Ultra und Abmessung 9400MediaTek steigert die Premium -Aufstellung mit Kompanio Ultra und Abmessung 9400Apr 12, 2025 am 11:52 AM

In diesem Monat hat MediaTek in diesem Monat eine Reihe von Ankündigungen gemacht, darunter das neue Kompanio Ultra und die Abmessung 9400. Diese Produkte füllen die traditionelleren Teile von MediaTeks Geschäft aus, die Chips für Smartphone enthalten

Diese Woche in AI: Walmart setzt Modetrends vor, bevor sie jemals passierenDiese Woche in AI: Walmart setzt Modetrends vor, bevor sie jemals passierenApr 12, 2025 am 11:51 AM

#1 Google gestartet Agent2Agent Die Geschichte: Es ist Montagmorgen. Als mit KI betriebener Personalvermittler arbeiten Sie intelligenter, nicht härter. Sie melden sich im Dashboard Ihres Unternehmens auf Ihrem Telefon an. Es sagt Ihnen, dass drei kritische Rollen bezogen, überprüft und geplant wurden

Generative KI trifft PsychobabbleGenerative KI trifft PsychobabbleApr 12, 2025 am 11:50 AM

Ich würde vermuten, dass du es sein musst. Wir alle scheinen zu wissen, dass Psychobabble aus verschiedenen Geschwätzern besteht, die verschiedene psychologische Terminologie mischen und oft entweder unverständlich oder völlig unsinnig sind. Alles was Sie tun müssen, um fo zu spucken

Der Prototyp: Wissenschaftler verwandeln Papier in PlastikDer Prototyp: Wissenschaftler verwandeln Papier in PlastikApr 12, 2025 am 11:49 AM

Laut einer neuen Studie, die diese Woche veröffentlicht wurde, wurden im Jahr 2022 nur 9,5% der im Jahr 2022 hergestellten Kunststoffe aus recycelten Materialien hergestellt. In der Zwischenzeit häufen sich Plastik weiter in Deponien - und Ökosystemen - um die Welt. Aber Hilfe ist unterwegs. Ein Team von Engin

See all articles

Heiße KI -Werkzeuge

Undresser.AI Undress

Undresser.AI Undress

KI-gestützte App zum Erstellen realistischer Aktfotos

AI Clothes Remover

AI Clothes Remover

Online-KI-Tool zum Entfernen von Kleidung aus Fotos.

Undress AI Tool

Undress AI Tool

Ausziehbilder kostenlos

Clothoff.io

Clothoff.io

KI-Kleiderentferner

AI Hentai Generator

AI Hentai Generator

Erstellen Sie kostenlos Ai Hentai.

Heißer Artikel

R.E.P.O. Energiekristalle erklärten und was sie tun (gelber Kristall)
3 Wochen vorBy尊渡假赌尊渡假赌尊渡假赌
R.E.P.O. Beste grafische Einstellungen
3 Wochen vorBy尊渡假赌尊渡假赌尊渡假赌
R.E.P.O. So reparieren Sie Audio, wenn Sie niemanden hören können
3 Wochen vorBy尊渡假赌尊渡假赌尊渡假赌
WWE 2K25: Wie man alles in Myrise freischaltet
4 Wochen vorBy尊渡假赌尊渡假赌尊渡假赌

Heiße Werkzeuge

WebStorm-Mac-Version

WebStorm-Mac-Version

Nützliche JavaScript-Entwicklungstools

SublimeText3 chinesische Version

SublimeText3 chinesische Version

Chinesische Version, sehr einfach zu bedienen

Dreamweaver Mac

Dreamweaver Mac

Visuelle Webentwicklungstools

mPDF

mPDF

mPDF ist eine PHP-Bibliothek, die PDF-Dateien aus UTF-8-codiertem HTML generieren kann. Der ursprüngliche Autor, Ian Back, hat mPDF geschrieben, um PDF-Dateien „on the fly“ von seiner Website auszugeben und verschiedene Sprachen zu verarbeiten. Es ist langsamer und erzeugt bei der Verwendung von Unicode-Schriftarten größere Dateien als Originalskripte wie HTML2FPDF, unterstützt aber CSS-Stile usw. und verfügt über viele Verbesserungen. Unterstützt fast alle Sprachen, einschließlich RTL (Arabisch und Hebräisch) und CJK (Chinesisch, Japanisch und Koreanisch). Unterstützt verschachtelte Elemente auf Blockebene (wie P, DIV),

Herunterladen der Mac-Version des Atom-Editors

Herunterladen der Mac-Version des Atom-Editors

Der beliebteste Open-Source-Editor