<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>Voice-Ai :: Kategorie :: Dokumentation für die AI Services</title><link>https://docs.ai.gwdg.de/categories/voice-ai/index.html</link><description/><generator>Hugo</generator><language>de</language><atom:link href="https://docs.ai.gwdg.de/categories/voice-ai/index.xml" rel="self" type="application/rss+xml"/><item><title>Voice AI FAQ</title><link>https://docs.ai.gwdg.de/user/ai-services/voice-ai/faq/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/voice-ai/faq/index.html</guid><description>Wie nutze ich den Voice-live-Tool effektiv? Für maximale Genauigkeit: Wählen Sie Ihre Eingabesprache aus!
Obwohl die automatische Erkennungsfunktion leistungsstark ist, erreicht das Transkriptionsmodell die höchste Genauigkeit und Geschwindigkeit, wenn Sie die gesprochene Sprache vorab angeben. Wenn Sie wissen, welche Sprache gesprochen wird, wird dringend empfohlen, sie aus der Dropdown-Liste auszuwählen.
Wie erfolgt die Transkription/Übersetzung in einem Online-Meeting oder allgemein aus dem System-Audio? Aus Sicherheits- und Datenschutzgründen können Web-Browser Ihre Computer-Lautsprecher-Ausgabe nicht direkt „hören“. Um ein Meeting (z. B. von Zoom, Teams usw.) oder jedes andere Audio, das auf Ihrem Computer abgespielt wird, zu transkribieren, müssen Sie ein virtuelles Audio-Kabel verwenden.
Diese kostenlose Software erstellt ein virtuelles „Loopback“-Gerät, das Ihren Lautsprecher-Audio an ein virtuelles Mikrofon weiterleitet, das Sie dann in dieser Web-Anwendung auswählen können.</description></item><item><title>KI-Dienste</title><link>https://docs.ai.gwdg.de/user/ai-services/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/index.html</guid><description>Die von GWDG angebotenen KI-Dienste bieten eine vielseitige Plattform für praktische KI-Anwendungen.
Unser Portfolio reicht von einem Chatbot mit fortgeschrittenen Funktionen (z. B. Retrieval-Augmented Generation, Werkzeugintegration, MCP) über Spracherkennung bis hin zur Bildverarbeitung.
Alle Dienste können bequem über eine Web-Oberfläche genutzt werden oder nahtlos über eine OpenAI-kompatible API in bestehende Systeme integriert werden.
Entwickelt im Rahmen des KISSKI-Projekts (KI-Service-Center für sensible und kritische Infrastrukturen) erfüllen die Dienste hohe Anforderungen an den Datenschutz und sind daher besonders gut für sensible Anwendungsszenarien geeignet.</description></item><item><title>Voice AI</title><link>https://docs.ai.gwdg.de/user/ai-services/voice-ai/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/voice-ai/index.html</guid><description>Eines der herausragenden Angebote von KISSKI ist sein KI-basiertes Transkriptions- und Untertitelungsdienst, Voice AI. Mit Hochleistungsrechnen (HPC) nutzt Voice AI das Whisper-Modell (large-v2), um Audio schnell zu transkribieren und Videountertitel zu generieren. Auf 680.000 Stunden beschrifteten Daten trainiert, erreicht Whisper die Leistung professioneller menschlicher Transkribenten und bietet zuverlässige automatische Spracherkennung (ASR) und Sprachübersetzung über verschiedene Datensätze und Bereiche hinweg. Benutzer können zwischen Aufgaben wie Transkription und Übersetzung wählen, um ihre Bedürfnisse zu erfüllen. Besonders bemerkenswert ist, dass dieser KISSKI-Dienst kostenlos zur Verfügung steht.</description></item></channel></rss>