Heim Technologie-Peripheriegeräte KI Microsoft kündigt das Text-to-Speech-Avatar-KI-Tool an, mit dem virtuelle digitale 3D-Menschen erstellt werden können

Microsoft kündigt das Text-to-Speech-Avatar-KI-Tool an, mit dem virtuelle digitale 3D-Menschen erstellt werden können

Nov 17, 2023 pm 12:50 PM

Microsoft hat auf der Ignite-Konferenz ein KI-Tool namens „Azure AI Speech Text to Speech (TTS) Avatar“ veröffentlicht, das angeblich realistische virtuelle Charaktere generieren kann. Dieses Tool ist jetzt zur Vorschau für die Öffentlichkeit zugänglich

微软公布 Text To Speech Avatar AI工具,可制作虚拟3D数字人

Microsoft sagte, dass Benutzer mithilfe des TTS-Avatars (Text-to-Speech) von Azure AI Speech einen virtuellen Avatar erstellen können, der auf „Texteingabe und Sprachinhalt“ basiert, und ihn mit Fototraining von realen Personen kombinieren können, um einen „auf realen interaktiven Chat-Robotern basierenden“ zu erstellen Menschen“ „, die in Unternehmensmarketing-, Geschäfts- oder Kundendienstszenarien eingesetzt werden können.

Es wird berichtet, dass der Text-to-Speech (TTS)-Avatar von Azure AI Speech hauptsächlich aus drei Modulen besteht, nämlich Textanalysator, TTS-Sprachsynthesizer und TTS-Virtual-Avatar-Synthesizer

Der Textanalysator analysiert zunächst den vom Benutzer eingegebenen Textinhalt und generiert eine Phonemsequenz. Anschließend wird das TTS-Sprachmodell im TTS-Soundsynthesizer die akustischen Eigenschaften des vom Benutzer eingegebenen Texts vorhersagen und dann den Sound synthetisieren. Schließlich wird das Klangsynthesemodell Avatar des neuronalen Netzwerks das Bild der Lippenform des Charakters basierend auf den oben genannten akustischen Eigenschaften vorhersagen und so letztendlich das Bild des virtuellen Avatars bilden

Microsoft erklärte, dass die herkömmliche Avatar-Produktion zeitaufwändig und arbeitsintensiv sei, die Einrichtung einer speziellen Aufnahmeumgebung erfordere und der Postproduktionsprozess der Aufnahme und Bearbeitung ebenfalls recht kostspielig sei. Derzeit wird der neueste Avatar-Dienst Azure AI Speech (TTS) von Microsoft verwendet. Nach der erstmaligen Einrichtung des Modells können Benutzer verschiedene Produkteinführungen, interaktive Videos usw. erstellen, indem sie einfach Text eingeben. Zusammen mit dem Microsoft Azure OpenAI Service und den TTS-Funktionen des neuronalen Netzwerks kann es auch ein natürlicheres interaktives Erlebnis bieten.

微软公布 Text To Speech Avatar AI工具,可制作虚拟3D数字人

微软公布 Text To Speech Avatar AI工具,可制作虚拟3D数字人

IT House berichtete, dass Microsoft ein Beispiel dafür gegeben hat, dass Benutzer den Azure AI Speech TTS-Avatar verwenden können, um verschiedene Videoinhalte stapelweise zu produzieren, wie zum Beispiel Videos zur Unternehmenskultur, Produkteinführungen oder den digitalen Avatar des CEO auf einer Konferenz. Darüber hinaus können Sie auch virtuelle Live-Übertragungen digitaler Menschen, Chat-Roboter, Geschäftsroboter und KI-Lehrer für den Online-Unterricht usw. erstellen.

微软公布 Text To Speech Avatar AI工具,可制作虚拟3D数字人

Microsoft gab bekannt, dass Azure AI Speech Synthesis (TTS)-Avatare jetzt für Azure-Abonnenten verfügbar sind und mehrere Sprachen unterstützen. Benutzer können ihren gewünschten Charakter aus voreingestellten Avatar-Optionen auswählen oder ihren Avatar anpassen

微软公布 Text To Speech Avatar AI工具,可制作虚拟3D数字人

Wenn Benutzer ihren eigenen virtuellen Avatar anpassen möchten, müssen sie eine Reihe von Charaktervideoclips hochladen. Die Azure-Plattform verarbeitet diese Videos dann online, um einen virtuellen Avatar zu generieren. Der Charakter selbst ist von der Tonquelle getrennt. Benutzer können die offizielle Standard-Tonquelle auswählen oder ihre eigene Trainings-Tonquelle hochladen.

Das obige ist der detaillierte Inhalt vonMicrosoft kündigt das Text-to-Speech-Avatar-KI-Tool an, mit dem virtuelle digitale 3D-Menschen erstellt werden können. Für weitere Informationen folgen Sie bitte anderen verwandten Artikeln auf der PHP chinesischen Website!

Erklärung dieser Website
Der Inhalt dieses Artikels wird freiwillig von Internetnutzern beigesteuert und das Urheberrecht liegt beim ursprünglichen Autor. Diese Website übernimmt keine entsprechende rechtliche Verantwortung. Wenn Sie Inhalte finden, bei denen der Verdacht eines Plagiats oder einer Rechtsverletzung besteht, wenden Sie sich bitte an admin@php.cn

Heiße KI -Werkzeuge

Undresser.AI Undress

Undresser.AI Undress

KI-gestützte App zum Erstellen realistischer Aktfotos

AI Clothes Remover

AI Clothes Remover

Online-KI-Tool zum Entfernen von Kleidung aus Fotos.

Undress AI Tool

Undress AI Tool

Ausziehbilder kostenlos

Clothoff.io

Clothoff.io

KI-Kleiderentferner

AI Hentai Generator

AI Hentai Generator

Erstellen Sie kostenlos Ai Hentai.

Heißer Artikel

R.E.P.O. Energiekristalle erklärten und was sie tun (gelber Kristall)
2 Wochen vor By 尊渡假赌尊渡假赌尊渡假赌
Repo: Wie man Teamkollegen wiederbelebt
1 Monate vor By 尊渡假赌尊渡假赌尊渡假赌
Hello Kitty Island Abenteuer: Wie man riesige Samen bekommt
4 Wochen vor By 尊渡假赌尊渡假赌尊渡假赌

Heiße Werkzeuge

Notepad++7.3.1

Notepad++7.3.1

Einfach zu bedienender und kostenloser Code-Editor

SublimeText3 chinesische Version

SublimeText3 chinesische Version

Chinesische Version, sehr einfach zu bedienen

Senden Sie Studio 13.0.1

Senden Sie Studio 13.0.1

Leistungsstarke integrierte PHP-Entwicklungsumgebung

Dreamweaver CS6

Dreamweaver CS6

Visuelle Webentwicklungstools

SublimeText3 Mac-Version

SublimeText3 Mac-Version

Codebearbeitungssoftware auf Gottesniveau (SublimeText3)

Was ist das Modellkontextprotokoll (MCP)? Was ist das Modellkontextprotokoll (MCP)? Mar 03, 2025 pm 07:09 PM

Das Modellkontextprotokoll (MCP): ein universeller Anschluss für KI und Daten Wir alle vertraut mit der Rolle von AI bei der täglichen Codierung. Replit, Github Copilot, Black Box AI und Cursor IDE sind nur einige Beispiele dafür, wie KI unsere Workflows optimiert. Aber stell dir vor

Aufbau eines lokalen Vision Agents mit Omniparser V2 und Omnitool Aufbau eines lokalen Vision Agents mit Omniparser V2 und Omnitool Mar 03, 2025 pm 07:08 PM

Microsoft's Omniparser V2 und Omnitool: Revolutionierung der GUI -Automatisierung mit KI Stellen Sie sich AI vor, das nicht nur versteht, sondern auch mit Ihrer Windows 11 -Oberfläche wie ein erfahrener Profi interagiert. Microsofts Omniparser V2 und Omnitool machen dies zu einer Re

Ich habe versucht, die Vibe -Codierung mit Cursor AI und es ist erstaunlich! Ich habe versucht, die Vibe -Codierung mit Cursor AI und es ist erstaunlich! Mar 20, 2025 pm 03:34 PM

Die Vibe -Codierung verändert die Welt der Softwareentwicklung, indem wir Anwendungen mit natürlicher Sprache anstelle von endlosen Codezeilen erstellen können. Inspiriert von Visionären wie Andrej Karpathy, lässt dieser innovative Ansatz Dev

Replit Agent: Ein Leitfaden mit praktischen Beispielen Replit Agent: Ein Leitfaden mit praktischen Beispielen Mar 04, 2025 am 10:52 AM

Revolutionierung der App -Entwicklung: Ein tiefes Eintauchen in den Replit Agent Müde, mit komplexen Entwicklungsumgebungen und dunklen Konfigurationsdateien zu ringen? Replit Agent zielt darauf ab, den Prozess der Umwandlung von Ideen in funktionale Apps zu vereinfachen. Diese AI-P

Runway Act-One Guide: Ich habe mich gefilmt, um es zu testen Runway Act-One Guide: Ich habe mich gefilmt, um es zu testen Mar 03, 2025 am 09:42 AM

Dieser Blog-Beitrag teilt mit meiner Erfahrung mit dem neuen Animation-Tool von Runway ML von ML und dem Deckung sowohl der Weboberfläche als auch der Python-API. Während der Versprechen waren meine Ergebnisse weniger beeindruckend als erwartet. Möchten Sie generative KI erkunden? Lernen Sie, LLMs in p zu verwenden

Top 5 Genai Starts vom Februar 2025: GPT-4,5, GROK-3 & MEHR! Top 5 Genai Starts vom Februar 2025: GPT-4,5, GROK-3 & MEHR! Mar 22, 2025 am 10:58 AM

Februar 2025 war ein weiterer bahnbrechender Monat für die Generative KI, die uns einige der am meisten erwarteten Modell-Upgrades und bahnbrechenden neuen Funktionen gebracht hat. Von Xais Grok 3 und Anthropics Claude 3.7 -Sonett, um g zu eröffnen

Wie benutze ich Yolo V12 zur Objekterkennung? Wie benutze ich Yolo V12 zur Objekterkennung? Mar 22, 2025 am 11:07 AM

Yolo (Sie schauen nur einmal) war ein führender Echtzeit-Objekterkennungsrahmen, wobei jede Iteration die vorherigen Versionen verbessert. Die neueste Version Yolo V12 führt Fortschritte vor, die die Genauigkeit erheblich verbessern

So verwenden Sie Dall-E 3: Tipps, Beispiele und Funktionen So verwenden Sie Dall-E 3: Tipps, Beispiele und Funktionen Mar 09, 2025 pm 01:00 PM

Dall-e 3: Ein generatives KI-Bilderstellungstool Generative AI revolutioniert die Erstellung von Inhalten, und Dall-E 3, das neueste Bildgenerierungsmodell von OpenAI, steht vor der Spitze. Veröffentlicht im Oktober 2023 baut es auf seinen Vorgängern Dall-E und Dall-E 2 auf

See all articles