Voice AI FAQ

Wie nutze ich den Voice-live-Tool effektiv?

Für maximale Genauigkeit: Wählen Sie Ihre Eingabesprache aus!
Obwohl die automatische Erkennungsfunktion leistungsstark ist, erreicht das Transkriptionsmodell die höchste Genauigkeit und Geschwindigkeit, wenn Sie die gesprochene Sprache vorab angeben. Wenn Sie wissen, welche Sprache gesprochen wird, wird dringend empfohlen, sie aus der Dropdown-Liste auszuwählen.

Wie erfolgt die Transkription/Übersetzung in einem Online-Meeting oder allgemein aus dem System-Audio?

Aus Sicherheits- und Datenschutzgründen können Web-Browser Ihre Computer-Lautsprecher-Ausgabe nicht direkt „hören“. Um ein Meeting (z. B. von Zoom, Teams usw.) oder jedes andere Audio, das auf Ihrem Computer abgespielt wird, zu transkribieren, müssen Sie ein virtuelles Audio-Kabel verwenden.
Diese kostenlose Software erstellt ein virtuelles „Loopback“-Gerät, das Ihren Lautsprecher-Audio an ein virtuelles Mikrofon weiterleitet, das Sie dann in dieser Web-Anwendung auswählen können.

Einrichtungsanleitung:

  • Windows: Laden Sie und installieren Sie VB-CABLE. Stellen Sie in den Audio-Einstellungen Ihrer Meeting-App den Lautsprecher auf „CABLE Input“. Wählen Sie in diesem Browserfenster „CABLE Output“ als Mikrofon.
  • macOS: Laden Sie und installieren Sie BlackHole. Erstellen Sie in „Audio MIDI Setup“ ein „Multi-Output Device“, das sowohl Ihre normalen Lautsprecher als auch BlackHole enthält. Legen Sie dies als Standard-Ausgabe Ihres Systems fest. Verwenden Sie in Ihrer Meeting-App die Standard-Ausgabe. Wählen Sie in diesem Browserfenster BlackHole als Mikrofon.
  • Linux: Sie können das PulseAudio Loopback-Modul verwenden. Laden Sie es mit dem Befehl: pactl load-module module-loopback. Verwenden Sie ein Werkzeug wie pavucontrol, um den Audio-Stream aus der Meeting-Anwendung auf die Eingabe Ihres Browsers umzuleiten.

Datenschutz

Werden meine Gespräche oder Nutzungsdaten für die KI-Weiterbildung oder ähnliche Zwecke verwendet?

Nein, Ihre Gespräche und Daten werden nicht zur Weiterbildung von KI-Modellen verwendet.

Werden meine Audio-Dateien und Gespräche zu irgendeinem Zeitpunkt auf Ihren Servern gespeichert?

Nein, Benutzer-Audio-Dateien oder BBB-Gespräche werden zu keinem Zeitpunkt auf unseren Servern gespeichert. Sobald Ihr Audio gesendet und die Antwort erhalten wurde, ist das Ergebnis nur noch in Ihrem Browser verfügbar. Die Transkriptions-/Übersetzungs-Ergebnisse werden auf unserem Datenübertragungs-Knoten gespeichert und nach 30 Tagen gelöscht. Dies gibt den Nutzern die Möglichkeit, ihre Ergebnisse innerhalb von 30 Tagen herunterzuladen. BBB-Transkriptionen, die in Etherpad geschrieben und mit lokalem MySQL gespeichert werden, werden ebenfalls nach 30 Tagen gelöscht (zukünftiger Dienst).

Welche Daten speichert Voice AI, wenn ich den Dienst nutze?

Wir speichern keine Gespräche oder Audio-Dateien auf unseren Servern. Transkriptions-/Übersetzungs-Ergebnisse werden für 30 Tage auf unserem Datenübertragungs-Knoten gespeichert. BBB-Transkriptionen, die in lokalem MySQL gespeichert werden, werden ebenfalls nach 30 Tagen gelöscht (zukünftiger Dienst). Außerdem erfassen wir einige Nutzungsstatistiken, um die Auslastung unseres Dienstes zu überwachen und die Benutzererfahrung zu verbessern. Dazu gehören Benutzernamen, Zeitstempel und die angeforderten Dienste.

Konvertierung größerer Audio-Dateien in FLAC-Format

Wenn Ihre Datei zu groß ist, können Sie Tools wie FFmpeg oder Audacity verwenden, um sie in das FLAC-Format zu konvertieren, das ein verlustfreies Format ist. Zum Beispiel mit FFmpeg:

ffmpeg -i input.wav -vn -acodec flac output.flac

Verfügbarkeit

Meine Institution ist an der Nutzung von Voice AI interessiert. Können wir es für unsere Nutzer bewerben? Könnten Sie eine zusätzliche Last für XXX Nutzer bewältigen?

Für große Institutionen kontaktieren Sie uns bitte direkt unter info@kisski.de.

Ist der Voice AI Dienst kostenlos?

Der Voice AI Dienst, der mit einem Academic Cloud-Konto zugänglich ist, ist kostenlos.