<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>Technische Dokumentation :: Dokumentation für die AI Services</title><link>https://docs.ai.gwdg.de/technical/index.html</link><description>Info In Kürze finden Sie an dieser Stelle die Technische Dokumentation unserer KI-Dienste.
Sie wird Hintergrundinformationen und Beschreibungen der technischen Infrastruktur enthalten, die über die Inhalte der Benutzerdokumentation hinausgehen.
Aktuell finden Sie hier insbesondere die Dokumentation der SAIA Plattform. Im Rahmen der Überarbeitung dieser Dokumentation, werden wir bei der Zuordnung der Inhalte diverse Änderungen vornehmen.
SAIA Plattform Budget Limits Rate Limits Token-Kostenberechnung</description><generator>Hugo</generator><language>de</language><atom:link href="https://docs.ai.gwdg.de/technical/index.xml" rel="self" type="application/rss+xml"/><item><title>SAIA Plattform</title><link>https://docs.ai.gwdg.de/technical/saia-platform/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/technical/saia-platform/index.html</guid><description>SAIA ist der skalierbare KI-Accelerator (AI), der unsere KI-Dienste hostet.
Zu diesen Diensten gehören Chat AI und CoCo AI, weitere werden in Kürze hinzukommen.
API-Schlüssel für die SAIA-API (Application Programming Interface) können beantragt und innerhalb Ihres Codes zur Nutzung der Dienste verwendet werden.
API-Schlüssel sind nicht erforderlich, um die Web-Oberfläche von Chat AI zu nutzen Web-Oberfläche.
Die SAIA-API eignet sich für interaktive Inferenz-Szenarien.
Falls Sie eine große Anzahl (z. B. Tausende von LLM-Anfragen) asynchron verarbeiten können, ist das Batch-Verfahren unseres HPC-Clusters die bessere Wahl.
Ihre Batch-Aufgabe wird zuverlässiger, schneller und kostengünstiger abgeschlossen.
Informieren Sie sich über die Einrichtung Ihres HPC-Clusters und die Nutzung von LLMs, um zu erfahren, wie Sie eine Batch-Inferenz-Aufgabe auf dem Cluster einrichten können.
vLLM ist eine weitere beliebte Wahl für LLM-Inferenz.</description></item></channel></rss>