<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>Llm :: Kategorie :: Dokumentation für die AI Services</title><link>https://docs.ai.gwdg.de/categories/llm/index.html</link><description/><generator>Hugo</generator><language>de</language><atom:link href="https://docs.ai.gwdg.de/categories/llm/index.xml" rel="self" type="application/rss+xml"/><item><title>Code-Vervollständigung</title><link>https://docs.ai.gwdg.de/user/ai-services/coco-ai/code_completion/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/coco-ai/code_completion/index.html</guid><description>Viele Code-Editoren bieten heute LLM-Integration an.
Code-Vervollständigungswerkzeuge liefern Inline-Vorschläge, während Sie tippen, und helfen Ihnen, Code schneller zu schreiben, indem sie die nächste Zeile vorhersagen.
Sie unterstützen durch die Vervollständigung von Funktions-Signaturen und die Vorschläge ganzer Codeblöcke basierend auf dem Kontext.
Sie bieten außerdem eine Chat-Oberfläche zum Erklären, Generieren und Bearbeiten von Code direkt in Ihrem Editor.
Info Um die internen Modelle, die auf unserer Plattform gehostet werden, mit den unten genannten Werkzeugen zu nutzen, benötigen Sie einen SAIA-API-Schlüssel.
Falls Sie noch keinen besitzen, verweisen Sie auf SAIA-API-Schlüssel, um einen zu beantragen.
Externe Modelle sind nicht über die API verfügbar.</description></item><item><title>Agenter Coding</title><link>https://docs.ai.gwdg.de/user/ai-services/coco-ai/agentic_coding/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/coco-ai/agentic_coding/index.html</guid><description>Agenter Coding geht über Chat und Inline-Vorschläge hinaus.
Diese Werkzeuge nutzen die Fähigkeit des Modells, mehrstufige Aufgaben autonom abzuschließen.
Das Modell kann Ihre Codebasis lesen, Dateien bearbeiten und Terminalbefehle ausführen.
Info Vergleich mit kommerziellen Modellen: Die Seite Kommerzielle Modelle – Agenter Coding beschreibt agente Coding-Workflows mit externen Anbietern wie Codex und Claude Code.
OpenCode und Claude Code unterstützen sowohl kommerzielle API-Schlüssel als auch einen SAIA-API-Schlüssel; die nachfolgenden Abschnitte beschreiben die SAIA-Einrichtung für beide.
Die unten beschriebenen Werkzeuge bieten vergleichbare agente Coding-Funktionen mit Ihrem SAIA-API-Schlüssel und Modellen, die auf der HPC-Infrastruktur von GWDG gehostet werden.
Dies ermöglicht es Nutzern, von modernen Code-Assistenten zu profitieren, während die Datenverarbeitung innerhalb der Infrastruktur des Instituts bleibt und so Datenschutz, Compliance und Vertraulichkeit gewährleistet werden.
Für viele Forschungs- und Verwaltungsaufgaben stellt dies eine praktische Alternative zu externen KI-Diensten dar, ohne die Kernfunktionen des agenten Coding zu opfern.</description></item><item><title>Chat AI FAQ</title><link>https://docs.ai.gwdg.de/user/ai-services/chat-ai/faq/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/chat-ai/faq/index.html</guid><description>Datenschutz Werden meine Gespräche oder Nutzungsdaten für die KI-Weiterbildung oder ähnliche Zwecke verwendet? Nein, unabhängig davon, ob Sie interne oder externe Modelle nutzen: Ihre Gespräche und Daten werden nicht zur Weiterbildung von KI-Modellen verwendet.
Wenn ich interne Modelle verwende, werden meine Nachrichten und Gespräche zu irgendeinem Zeitpunkt auf Ihren Servern gespeichert? Nein, Nutzernachrichten und KI-Antworten werden zu keinem Zeitpunkt auf unseren Servern gespeichert. Sobald Ihre Nachricht gesendet und die Antwort erhalten wurde, ist das Gespräch nur noch in Ihrem Browser verfügbar.</description></item><item><title>Personas</title><link>https://docs.ai.gwdg.de/user/ai-services/chat-ai/features/personas/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/chat-ai/features/personas/index.html</guid><description>Chat AI unterstützt das Laden vorgefertigter Personas aus Konfigurationsdateien im JSON-Format. Jede JSON-Datei enthält den Systemprompt, Einstellungen und Gespräche, sodass Sie eine Persona einfach in Chat AI laden können. Obwohl diese Dateien über die Import-Funktion geladen werden können, unterstützt Chat AI auch das direkte Importieren öffentlicher JSON-Dateien aus dem Web, indem Sie die URL angeben.
Beispiel-Personas Wenn Sie lediglich einen schnellen Link zum Laden einer bestimmten Persona benötigen, ist dies Ihr Kapitel.
Hier sind einige der interessanten und nützlichen Personas, die die KI-Community entwickelt hat:</description></item><item><title>Verfügbare Modelle</title><link>https://docs.ai.gwdg.de/user/ai-services/chat-ai/models/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/chat-ai/models/index.html</guid><description>Chat AI bietet eine große Auswahl an modernen, Open Weight großen Sprachmodellen (LLMs), die auf unserer Plattform mit höchsten Standards zum Datenschutz gehostet werden. Die Daten, die an diese Modelle gesendet werden – einschließlich der Prompts und Nachrichteninhalte – werden an keiner Stelle in unseren Systemen gespeichert. Zusätzlich bietet Chat AI Modelle, die extern gehostet werden, wie Anthropic Claude und OpenAI GPT-5.
Verfügbare Modelle werden regelmäßig aktualisiert, sobald neuere, leistungsfähigere Versionen veröffentlicht werden. Wir wählen Modelle für unsere Dienste basierend auf Nutzerbedarf, Kosten und Leistung in verschiedenen Benchmarks, wie HumanEval, MATH, HellaSwag, MMLU usw. Bestimmte Modelle sind für spezifische Aufgaben und Einstellungen besonders gut geeignet, was unten nach bestem Wissen beschrieben wird.</description></item><item><title>Was ist ein Token?</title><link>https://docs.ai.gwdg.de/user/basics/token/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/basics/token/index.html</guid><description>Was ist ein Token? Ein Token ist die kleinste Einheit, die ein Sprachmodell verarbeiten kann. Es ist nicht einfach ein einzelnes Wort, sondern ein Teil eines Wortes, ein Satzzeichen, ein Leerzeichen oder eine Kombination aus diesen Elementen. Tokens sind die Bausteine, aus denen der gesamte Text in einer Anfrage für ein KI-Modell zerlegt wird.
Wie werden Tokens erzeugt? Die Umwandlung von Text in Tokens erfolgt durch ein Verfahren namens Tokenisierung. Dieser Prozess teilt den Eingabetext in kleinere Einheiten auf, die das Modell effizient verarbeiten kann. Die Art und Weise, wie ein Text in Tokens zerlegt wird, hängt von der spezifischen Architektur des Modells ab.</description></item><item><title>Erklärung zur KI-Transparenz</title><link>https://docs.ai.gwdg.de/user/ai-services/arcana/transparency/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/arcana/transparency/index.html</guid><description>Ziel Typische LLMs haben den Vorteil, aber auch das Problem, dass sie auf einer unglaublich großen Menge an Daten trainiert wurden.
Das bedeutet, dass sie viel Wissen besitzen, aber oft nicht in der Lage sind, sehr spezifische Fragen zu beantworten.
In solchen Fällen sind LLMs sehr anfällig für Halluzinationen, d. h., sie erfinden einfach Dinge.
Eine Möglichkeit, die Leistung von LLMs bei sehr spezifischen Fragen zu verbessern, ist die Verwendung von Retrieval-Augmented-Generation (RAG).
Hier geben Benutzer benutzerdefinierte Dokumente an, die die Wissensbasis enthalten, über die sie später Fragen stellen möchten.
Bevor ein LLM auf eine Benutzeranfrage antwortet, werden die zuvor vom Benutzer bereitgestellten relevantesten Dokumente abgerufen und dem LLM als zusätzlicher Kontext zur Verfügung gestellt.</description></item><item><title>Nutzungsvoraussetzungen</title><link>https://docs.ai.gwdg.de/user/terms-and-conditions/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/terms-and-conditions/index.html</guid><description>Allgemeine Bedingungen Für die Nutzung der Dienste der GWDG gelten allgemein folgende Bedingungen:
Nutzungsordnung der GWDG Allgemeine Geschäftsbedingungen (AGB) der GWDG Datenschutzerklärung der GWDG Spezielle Bedingungen Für die Nutzung der KI-Dienste gelten außerdem folgende ergänzende Bestimmungen:
Nutzungsbedingungen KI-Dienste Datenschutzhinweise KI-Dienste</description></item><item><title>Request</title><link>https://docs.ai.gwdg.de/user/basics/request/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/basics/request/index.html</guid><description>Wie eine Anfrage geprüft wird Jede Anfrage durchläuft drei Schleusen, bevor sie ein Modell erreicht: den API-Schlüssel, mit dem sie erstellt wurde, das Benutzerkonto, zu dem dieser Schlüssel gehört, und die Organisation, zu der dieses Konto gehört. Jede Schleuse verfügt über eigene Limits, unterteilt in die zwei oben genannten Arten: eine Anfragerate, gezählt in Anfragen, und ein Budget, gezählt in Euro. Die Anfrage wird gegen jedes Limit gemessen, das auf dieser Ebene gesetzt ist, und sie wird abgelehnt, sobald eines davon überschritten wird, ohne dass die späteren Schleusen konsultiert werden. Erst wenn alle drei Schleusen passiert sind, erreicht die Anfrage ein Modell, und ihre Kosten werden dann gleichzeitig auf die Budgets aller drei Ebenen zurückgebucht.</description></item><item><title>Nutzungsbedingungen KI Dienste</title><link>https://docs.ai.gwdg.de/user/terms-and-conditions/terms-of-use/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/terms-and-conditions/terms-of-use/index.html</guid><description>Teil A: Allgemeine Bestimmungen (Gilt für alle KI Dienste)
§1 Allgemeine Bestimmungen Es gelten die AGB der Academic Cloud.
§2 Registrierung und Zugriff Der Zugriff auf diesen Dienst erfordert eine Academic-Cloud-ID. Die Nutzung einer Academic-Cloud-ID unterliegt der Annahme der Nutzungsbedingungen der “Academic Cloud”.</description></item><item><title>Open-Weight-Modelle</title><link>https://docs.ai.gwdg.de/user/basics/open-weight-models/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/basics/open-weight-models/index.html</guid><description>Was sind Open-Weight-Modelle? Open-Weight-Modelle sind große Sprachmodelle, deren Trainingsgewichte („Weights“) öffentlich zugänglich sind. Anders als kommerzielle Modelle, die von Unternehmen wie OpenAI oder Anthropic geschützt und nur über eine API zugänglich sind, können Open-Weight-Modelle von jedem frei heruntergeladen, lokal installiert und genutzt werden.
Wie unterscheiden sich Open-Weight-Modelle von kommerziellen Modellen? Merkmal Open-Weight-Modelle Kommerzielle Modelle (z.B. GPT-4, Claude Opus) Lokale Nutzung Ja - können auf eigenen Servern oder Rechnern laufen Nein - nur über Cloud-Endpunkte Anpassung Ja - können für spezifische Aufgaben finegetuned werden Nein - nur über Prompt-Engineering Transparenz Hohe Transparenz: Quellcode und Gewichte sind öffentlich Geringe Transparenz: Nur die API ist verfügbar Datenschutz Hoher Datenschutz: Daten bleiben lokal Daten werden an externe Anbieter gesendet Warum sind Open-Weight-Modelle wichtig? Datenschutz und Kontrolle
Da die Modelle lokal laufen, bleiben Ihre Daten auf eigenen Systemen. Keine Daten werden an Dritte übermittelt - ideal für sensible Forschungsdaten oder vertrauliche Unternehmensinformationen.</description></item><item><title>Datenschutzbestimmungen KI-Dienste</title><link>https://docs.ai.gwdg.de/user/terms-and-conditions/data-privacy/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/terms-and-conditions/data-privacy/index.html</guid><description>1. Allgemeine Informationen (Gilt für alle Dienste)
Verantwortlich für die Datenverarbeitung Der Verantwortliche für die Datenverarbeitung im Sinne des Art. 4 Nr. 7 DSGVO und anderer nationaler Datenschutzgesetze der Mitgliedsstaaten sowie sonstiger datenschutzrechtlicher Bestimmungen ist die:
Gesellschaft für wissenschaftliche Datenverarbeitung mbH Göttingen Burckhardtweg 4 37077 Göttingen Deutschland Tel: +49 (0) 551 39-30001 E-Mail: support@gwdg.de Website: www.gwdg.de Vertreten durch den Geschäftsführer. Verantwortliche Stelle ist die natürliche oder juristische Person, die allein oder gemeinsam mit anderen über die Zwecke und Mittel der Verarbeitung von personenbezogenen Daten entscheidet.</description></item><item><title>Migrationsleitfaden</title><link>https://docs.ai.gwdg.de/user/ai-services/arcana/migration-guide/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/arcana/migration-guide/index.html</guid><description>Warnung Dieser Dienst befindet sich derzeit in der Beta-Phase und wird regelmäßig aktualisiert.
Das gilt auch für die Dokumentation.
Mit der Einführung unseres neuen RAG-Managers haben wir die Benutzeroberfläche und den Indexierungsprozess verbessert.
Aufgrund architektonischer Änderungen ist die neue Oberfläche nur teilweise rückwärtskompatibel, insbesondere hinsichtlich der Dateispeicherung und Indexierung.
Dieser Leitfaden erklärt:
Was weiterhin zwischen der alten und neuen Oberfläche funktioniert Was nicht funktioniert Wie Sie Ihre bestehenden Arcanas vom alten Manager auf das neue System migrieren können Details Die alte Version ist während der Übergangsphase weiterhin zugänglich und wird in den nächsten Monaten entfernt werden. Sie können sie weiterhin hier nutzen: https://chat-ai.academiccloud.de/arcanas-old</description></item><item><title>RAG-Dienst</title><link>https://docs.ai.gwdg.de/user/ai-services/arcana/rag-service/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/arcana/rag-service/index.html</guid><description>Warnung Dieser Dienst befindet sich derzeit in der Beta-Phase und wird regelmäßig aktualisiert.
Das gilt auch für die Dokumentation.
RAG (Retrieval-Augmented Generation) ist eine fortschrittliche KI-Technik, die darauf abzielt, die Genauigkeit, Zuverlässigkeit und kontextuelle Relevanz von KI-generierten Antworten zu verbessern.
Traditionelle KI-Modelle wie große Sprachmodelle (LLMs) stützen sich ausschließlich auf vortrainierte Daten, um Antworten zu generieren.
Obwohl diese Modelle informative Antworten liefern können, sind sie durch die Informationen begrenzt, auf die sie trainiert wurden, die veraltet sein können oder bestimmte Themen nicht ausreichend detailliert abdecken.</description></item><item><title>Agenter Coding</title><link>https://docs.ai.gwdg.de/user/ai-services/commercial-models/agentic-coding/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/commercial-models/agentic-coding/index.html</guid><description>Dieser Abschnitt dokumentiert agente Coding-Werkzeuge, die mit dem kommerziellen Modellangebot von GWDG genutzt werden können.
Für Codex und Claude Code benötigen Sie kommerzielle Zugangsdaten von support@gwdg.de.
Für OpenCode sind beide Einrichtungen möglich:
mit einem SAIA-API-Schlüssel
mit Schlüsseln für kommerzielle Modelle
Codex
Claude Code
OpenCode {class=“children children-type-tree children-sort-”}</description></item><item><title>Codex</title><link>https://docs.ai.gwdg.de/user/ai-services/commercial-models/agentic-coding/codex/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/commercial-models/agentic-coding/codex/index.html</guid><description>Codex kann mit dem kommerziellen Modellangebot von GWDG über Azure OpenAI genutzt werden.
Wählen Sie eine Einrichtung: VS Code CLI Was Sie für VS Code benötigen einen kommerziellen Endpunkt und API-Schlüssel von support@gwdg.de den Bereitstellungsnamen, der mit Ihrer Ressource verwendet werden soll Visual Studio Code mit der OpenAI-Erweiterung Codex für Visual Studio Code 1. VS Code-Erweiterung installieren Im VS Code-Markt installieren Sie openai.chatgpt. Dokumentation: Codex-IDE-Erweiterung 2. Azure OpenAI-Konfiguration Während des Onboardings erhalten Sie möglicherweise bereits verwendbare config.toml- und .env-Dateien von GWDG.
Falls nicht, erstellen Sie die Dateien manuell mit der gleichen Struktur wie unten gezeigt.</description></item><item><title>Einrichten einer Arcana</title><link>https://docs.ai.gwdg.de/user/ai-services/arcana/getting-started/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/arcana/getting-started/index.html</guid><description>Warnung Dieser Dienst befindet sich derzeit in der Beta-Phase und wird regelmäßig aktualisiert.
Das gilt auch für die Dokumentation.
Inhaltsverzeichnis:
Erster Login Erstellen einer Arcana Hochladen von Dateien Anzeigen Ihres Zugangslinks Aktualisieren von Dateien in einer Arcana Die Prozess-Screenshots enthalten leere Felder.
Diese werden an den Stellen durch Ihren Benutzernamen ersetzt.
Erster Login Gehen Sie zur Haupt-Arcana-Seite und klicken Sie auf „Registrieren“.
Sie müssen sich zunächst mit Ihrem Academic Cloud-Konto anmelden.</description></item><item><title>Claude Code</title><link>https://docs.ai.gwdg.de/user/ai-services/commercial-models/agentic-coding/claude-code/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/commercial-models/agentic-coding/claude-code/index.html</guid><description>Claude Code kann mit dem kommerziellen Modellangebot von GWDG über Microsoft Foundry genutzt werden.
Info Claude Code kann auch auf die Modelle auf der HPC-Infrastruktur von GWDG mit nur einem SAIA-API-Schlüssel verweisen, ohne ein Anthropic-Konto oder einen kommerziellen Endpunkt zu benötigen.
Für diese Einrichtung siehe CoCo AI – Claude Code.
Wählen Sie eine Einrichtung: VS Code CLI Was Sie für VS Code benötigen einen kommerziellen Endpunkt oder Ressourcennamen und API-Schlüssel von support@gwdg.de den Namen der Claude-Deployment, die standardmäßig verwendet werden soll Visual Studio Code 1.98 oder neuer die Claude Code-Erweiterung aus dem VS Code-Markt Claude für Visual Studio Code 1. Installieren der VS Code-Erweiterung Im VS Code-Markt installieren Sie Claude Code von Anthropic. Voraussetzung: VS Code 1.98 oder neuer. Dokumentation der Erweiterung: Claude Code in VS Code 2. Foundry-Zugriff in Claude Code konfigurieren Während des Onboardings erhalten Sie möglicherweise eine vorbereitete settings.json von GWDG.
Falls nicht, erstellen Sie die Datei manuell mit der gleichen Struktur wie unten gezeigt.</description></item><item><title>KI-Dienste</title><link>https://docs.ai.gwdg.de/user/ai-services/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/index.html</guid><description>Die von GWDG angebotenen KI-Dienste bieten eine vielseitige Plattform für praktische KI-Anwendungen.
Unser Portfolio reicht von einem Chatbot mit fortgeschrittenen Funktionen (z. B. Retrieval-Augmented Generation, Werkzeugintegration, MCP) über Spracherkennung bis hin zur Bildverarbeitung.
Alle Dienste können bequem über eine Web-Oberfläche genutzt werden oder nahtlos über eine OpenAI-kompatible API in bestehende Systeme integriert werden.
Entwickelt im Rahmen des KISSKI-Projekts (KI-Service-Center für sensible und kritische Infrastrukturen) erfüllen die Dienste hohe Anforderungen an den Datenschutz und sind daher besonders gut für sensible Anwendungsszenarien geeignet.</description></item><item><title>So verwenden Sie Arcana</title><link>https://docs.ai.gwdg.de/user/ai-services/arcana/how-to-use/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/arcana/how-to-use/index.html</guid><description>Warnung Dieser Dienst befindet sich derzeit in der Beta-Phase und wird regelmäßig aktualisiert.
Das gilt auch für die Dokumentation.
Warnung Bisher funktionierte RAG/Arcana nur mit bestimmten Modellen. Dies ist nicht mehr der Fall – Arcana funktionieren nun mit jedem Modell.
Die bisherige Methode, Arcana mit Modellen zu verwenden, die im Namen „RAG“ enthalten (oder das kleine Buch-Symbol haben), wird in Zukunft nicht mehr unterstützt. Bitte verwenden Sie die GWDG-Werkzeuge gemäß der untenstehenden Anleitung!</description></item><item><title>OpenCode</title><link>https://docs.ai.gwdg.de/user/ai-services/commercial-models/agentic-coding/opencode/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/commercial-models/agentic-coding/opencode/index.html</guid><description>OpenCode kann in der GWDG-Umgebung auf mehrere Weisen genutzt werden.
Derzeit sind folgende Einrichtungen möglich:
mit einem SAIA-API-Schlüssel für lokal gehostete Modelle mit externen kommerziellen Schlüsseln für den Zugriff auf kommerzielle Modelle Wenn Sie lokal gehostete Modelle benötigen, verwenden Sie SAIA.
Wenn Sie Zugriff auf externe kommerzielle Modelle benötigen, verwenden Sie Ihre kommerziellen Zugangsdaten.
Weitere Dokumentation OpenCode-Anbieter OpenCode-Modelle OpenCode-Einführung SAIA-Dokumentation</description></item><item><title>SAIA Plattform</title><link>https://docs.ai.gwdg.de/technical/saia-platform/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/technical/saia-platform/index.html</guid><description>SAIA ist der skalierbare KI-Accelerator (AI), der unsere KI-Dienste hostet.
Zu diesen Diensten gehören Chat AI und CoCo AI, weitere werden in Kürze hinzukommen.
API-Schlüssel für die SAIA-API (Application Programming Interface) können beantragt und innerhalb Ihres Codes zur Nutzung der Dienste verwendet werden.
API-Schlüssel sind nicht erforderlich, um die Web-Oberfläche von Chat AI zu nutzen Web-Oberfläche.
Die SAIA-API eignet sich für interaktive Inferenz-Szenarien.
Falls Sie eine große Anzahl (z. B. Tausende von LLM-Anfragen) asynchron verarbeiten können, ist das Batch-Verfahren unseres HPC-Clusters die bessere Wahl.
Ihre Batch-Aufgabe wird zuverlässiger, schneller und kostengünstiger abgeschlossen.
Informieren Sie sich über die Einrichtung Ihres HPC-Clusters und die Nutzung von LLMs, um zu erfahren, wie Sie eine Batch-Inferenz-Aufgabe auf dem Cluster einrichten können.
vLLM ist eine weitere beliebte Wahl für LLM-Inferenz.</description></item><item><title>Chat AI Free</title><link>https://docs.ai.gwdg.de/procurement/chatai_free/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/procurement/chatai_free/index.html</guid><description>Chat AI Free Chat AI Free gewährt Zugang zu den von der GWDG gehosteten Open-Weight-Models in Göttingen für Test- und Evaluierungszwecke. Alle Nutzenden müssen über eine Academic ID und eine gültige E-Mail-Adresse verfügen. Der Dienst ist kostenlos und kann auf individueller Basis in Anspruch genommen werden.
Einschränkungen für Chat AI Free Für die kostenlose Variante werden minimale Cluster-Ressourcen zugewiesen. Reduzierte Liste verfügbarer Open Weight KI-Modelle Nur Zugriff auf Chat AI service, Arcana/RAG und CoCo AI Kein Zugriff auf Image AI, Voice AI, Protein AI Nur ein API-Key pro Benutzer Auf Best-Effort-Basis Keine garantierte Verfügbarkeit Keine garantierten Antwortzeiten Reduzierte Anfrage-Ratenlimits Vertragliches Für „Chat AI Free" gibt es keinen zusätzlichen Vertrag. Nutzende müssen unsere Nutzungsbedingungen unter den angegebenen Links akzeptieren.</description></item><item><title>Chat AI Prepaid</title><link>https://docs.ai.gwdg.de/procurement/chatai_prepaid/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/procurement/chatai_prepaid/index.html</guid><description>Chat AI Prepaid Chat AI Prepaid gewährt Zugang zu den von der GWDG gehosteten Open-Weight-Models in Göttingen. Es richtet sich an Organisationen, die feste Budgets und jährliche Zahlungspläne wünschen und gleichzeitig während eines laufenden Vertragszyklus eine gewisse Budgetflexibilität bewahren möchten. Der Vertrag ist für 12 Monate gültig und kann auf Anfrage verlängert werden. Die Organisation muss zudem einen Academic Cloud Basis-Vertrag unterzeichnen. Die Nutzung der KI-Modelle über unsere Weboberfläche oder per API ist optional.</description></item><item><title>Chat AI Flexible</title><link>https://docs.ai.gwdg.de/procurement/chatai_flexible/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/procurement/chatai_flexible/index.html</guid><description>Chat AI Flexible Chat AI Flexible gewährt Zugang zu den von der GWDG gehosteten Open-Weight-Models in Göttingen. Es richtet sich an Organisationen, die monatliche Zahlungspläne für eine flexible Nutzung der KI-Modelle benötigen. Die üblichen Anwendungsfälle sind öffentlich zugängliche Anwendungen. Der Vertrag ist für 12 Monate gültig und kann auf Anfrage verlängert werden. Die Organisation muss zudem einen Academic Cloud Basis-Vertrag unterzeichnen. Die Nutzung der KI-Modelle über unsere Weboberfläche oder per API ist optional.</description></item><item><title>Chat AI Externe Modelle Prepaid</title><link>https://docs.ai.gwdg.de/procurement/chatai_external_prepaid/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/procurement/chatai_external_prepaid/index.html</guid><description>Chat AI Externe Modelle Prepaid Chat AI Prepaid gewährt Zugang zu den extern gehosteten KI-Modellen. Es richtet sich an Organisationen, die feste Budgets und jährliche Zahlungspläne wünschen und gleichzeitig während eines laufenden Vertragszyklus eine gewisse Budgetflexibilität bewahren möchten. Der Vertrag ist für 12 Monate gültig und kann auf Anfrage verlängert werden. Die Organisation muss zudem einen Academic Cloud Basis-Vertrag unterzeichnen. Die Nutzung der KI-Modelle über unsere Weboberfläche oder per API ist optional.</description></item><item><title>Chat AI Externe Modelle Flexible</title><link>https://docs.ai.gwdg.de/procurement/chatai_external_flexible/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/procurement/chatai_external_flexible/index.html</guid><description>Chat AI Externe Modelle Flexible Chat AI Externe Modelle Flexible gewährt Zugang zu extern gehosteten KI-Modellen. Es richtet sich an Organisationen, die monatliche Zahlungspläne für eine flexible Nutzung der KI-Modelle benötigen. Die üblichen Anwendungsfälle sind öffentlich zugängliche Anwendungen und interne Tools mit variabler Nutzung. Der Vertrag ist für 12 Monate gültig und kann auf Anfrage verlängert werden. Die Organisation muss zudem einen Academic Cloud Basis-Vertrag unterzeichnen. Die Nutzung der KI-Modelle über unsere Weboberfläche oder per API ist optional.</description></item><item><title>Token Preise</title><link>https://docs.ai.gwdg.de/procurement/token-price/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/procurement/token-price/index.html</guid><description>Open Weight Modelle in SAIA Preise per 1 Millionen Token Info Die Preistabelle zeigt nur beispielhafte Preise und ist nicht bindend. Wir finalisieren aktuell die Performancetests für die verschiedenen Modelle und werden die gültigen Preise demnächst hier bekannt geben.</description></item><item><title>Budget Limits</title><link>https://docs.ai.gwdg.de/technical/saia-platform/limits_budget/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/technical/saia-platform/limits_budget/index.html</guid><description>Vom Vertrag zum Budget Die Budgets einer Organisation ergeben sich aus dem, was sie gekauft hat:
Schritt Berechnung Beispiel Jahresbudget nach Vertrag 72.000 € Monatsbudget Jahr ÷ 12 6.000 € Tagesbudget Monat ÷ 15 400 € Der Tageswert wird durch 15 geteilt, nicht durch 30, und das ist absichtlich. Bei ÷ 30 könnten Sie nie mehr als den gleichmäßigen Tagesanteil nutzen, und eine Frist oder eine Lehrwoche würde an die Grenze stoßen. Die Division durch 15 ergibt etwa das Doppelte des gleichmäßigen Tagessatzes als Burst-Zulage: lastintensive Tage sind möglich, aber dieses Tempo den ganzen Monat aufrechtzuerhalten nicht.</description></item><item><title>Rate Limits</title><link>https://docs.ai.gwdg.de/technical/saia-platform/limits_rate/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/technical/saia-platform/limits_rate/index.html</guid><description>Wie haben wir Rate- und Budgetlimits für jede Organisation berechnet? Zwei separate Fragen mit unterschiedlichen Antworten. Die Limits einer Organisation leiten sich aus ihrem Vertrag ab, sodass das, was sie gekauft hat, und das, was sie pro Tag ausgeben darf, übereinstimmen.
Die Einheit, die Euro mit Anfragen verbindet Ein Budget wird in Euro gemessen und ein Rate-Limit in Anfragen, daher benötigt die Übersetzung des einen in das andere einen Umrechnungsfaktor. Abgeleitet aus echten Nutzungsstatistiken bei der GWDG: Eine durchschnittliche Anfrage besteht aus ungefähr 10.000 Token, was bei etwa 1 € pro Million Token etwa 0,01 € pro Anfrage entspricht.</description></item><item><title>Token-Kostenberechnung</title><link>https://docs.ai.gwdg.de/technical/saia-platform/token_cost_cal/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/technical/saia-platform/token_cost_cal/index.html</guid><description>Info Die untenstehenden GPU-Raten und Token-Preise sind die Werte, die für die Berechnung der hier gezeigten Beispiele verwendet werden. Die autoritativen und aktuellsten Preise für jedes Modell finden Sie in unserer aktuellen Preisliste.
Wie hoch sind unsere Kosten? Alles, was Sie nutzen, wird tokengenau abgerechnet: Die Eingabe- und Ausgabetokens jeder Anfrage werden gezählt und entsprechend dem Modell, das sie verarbeitet hat, berechnet.</description></item><item><title>API-Nutzung</title><link>https://docs.ai.gwdg.de/user/ai-services/arcana/api-usage/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/arcana/api-usage/index.html</guid><description>Warnung Dieser Dienst befindet sich derzeit in der Beta-Phase und wird regelmäßig aktualisiert.
Das gilt auch für die Dokumentation.
Der Arcana-Manager stellt einen API-Endpunkt zur Verfügung, den Sie nutzen können.
Mit diesem Endpunkt können Sie alle Aktionen durchführen, die die Frontend-Oberfläche des Arcana-Managers unterstützt.
Um die API zu nutzen, benötigen Sie zunächst einen API-Schlüssel, den Sie auf unserer Website beantragen können. Dieser Schlüssel funktioniert über alle unsere Dienste hinweg. Wenn Sie bereits die LLMs über die API nutzen, können Sie denselben Schlüssel verwenden.
Andernfalls können Sie Ihren Schlüssel gemäß der Anleitung beantragen.</description></item><item><title>Arcana/RAG</title><link>https://docs.ai.gwdg.de/user/ai-services/arcana/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/arcana/index.html</guid><description>Arcana ist ein Retrieval-Augmented Generation (RAG)-Dienst, der es Ihnen ermöglicht, mit Dokumenten – wie Forschungsarbeiten, Handbüchern oder Lernmaterialien – über natürliche Sprache zu interagieren.
Der Arcana-Dienst arbeitet zusammen mit unserem Chat AI-Dienst.
LLMs profitieren von RAG (Retrieval-Augmented Generation), indem sie relevante Informationen aus einer Dokumenten-Sammlung (Arcana) nutzen, um genauere, zuverlässigere und kontextbasierte Antworten zu generieren.
Um den Dienst nutzen zu können, müssen Sie Ihr Konto für die Arcana-Seite aktivieren und eine Arcana gemäß der Anleitung zum Starten einrichten.
Sobald dies erledigt ist, können Sie sie mit Kollegen oder der Öffentlichkeit teilen.
Details zu diesem Prozess finden Sie in den Nutzungsszenarien.</description></item><item><title>Chat AI</title><link>https://docs.ai.gwdg.de/user/ai-services/chat-ai/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/chat-ai/index.html</guid><description>Chat AI ist ein Webdienst, der über eine funktionenreiche, benutzerfreundliche Oberfläche Zugriff auf eine große Auswahl an großen Sprachmodellen (LLMs) bietet.
Er bietet eine sorgfältig ausgewählte Auswahl beliebter Open-Weight-Modelle, die in unserem eigenen Rechenzentrum laufen, sowie anonymen Zugriff auf externe Modelle von kommerziellen Anbietern.
Die Web-Oberfläche wird auf der Cloud-Infrastruktur von GWDG gehostet und leitet Ihre Anfragen sicher über unseren skalierbaren SAIA-Backend-Service an das ausgewählte Modell weiter, wobei entweder auf lokale HPC-Hardware oder, bei Modellen, die als extern gekennzeichnet sind, auf den Service-Endpunkt des kommerziellen Anbieters umgeleitet wird.
Unser KI-Team aktualisiert die Liste der unterstützten Modelle regelmäßig und entwickelt kontinuierlich neue Funktionen.</description></item><item><title>CoCo AI (Code-Assistent)</title><link>https://docs.ai.gwdg.de/user/ai-services/coco-ai/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/coco-ai/index.html</guid><description>CoCo AI ist unser KI-gestützter Code-Service, der Chat AI nutzt und über Ihren SAIA-API-Schlüssel zugänglich ist.
Er bringt große Sprachmodelle direkt in Ihre Entwicklungsumgebung, um Codevorschläge, chatbasierte Unterstützung und autonome mehrstufige Codieraufgaben zu ermöglichen.
Erste Schritte Bevor Sie ein Werkzeug konfigurieren, benötigen Sie:
Einen SAIA-API-Schlüssel. Falls Sie noch keinen besitzen, fordern Sie ihn hier an. Einen unterstützten Editor oder Terminal. Siehe die Abschnitte unten. Ein Modell zum Einsatz. Blättern Sie durch die verfügbaren Modelle. Wir empfehlen, mit qwen3-coder-30b-a3b-instruct oder devstral-2-123b-instruct-2512 für Codieraufgaben zu beginnen. Info Nur Modelle, die auf der HPC-Infrastruktur von GWDG gehostet werden (interne Modelle), sind über die API verfügbar.
Externe Modelle (z. B. GPT-4, Claude) sind nur über die Chat AI-Web-Oberfläche zugänglich und können nicht mit CoCo AI verwendet werden.</description></item><item><title>Docling-Prozess</title><link>https://docs.ai.gwdg.de/user/ai-services/arcana/docling-process/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/arcana/docling-process/index.html</guid><description>Warnung Dieser Dienst befindet sich derzeit in der Beta-Phase und wird regelmäßig aktualisiert.
Das gilt auch für die Dokumentation.
Der RAG-Dienst bietet Nutzern eine effiziente Möglichkeit, PDF-Dokumente über Docling hochzuladen und zu verarbeiten.
Das System konvertiert hochgeladene PDFs in Markdown-Format und annotiert sie automatisch.
Die erweiterte Markdown-Ausgabe, auch als Markdown Plus bezeichnet, enthält Metadaten und strukturelle Anmerkungen, die die Dokumentenverarbeitung und Anpassung verbessern.
Dieser Dienst verwendet eine abgeänderte Fork der Docling-API mit zahlreichen Anpassungen, die in Zukunft veröffentlicht werden.</description></item><item><title>Features</title><link>https://docs.ai.gwdg.de/user/ai-services/chat-ai/features/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/chat-ai/features/index.html</guid><description>Dieser Abschnitt sammelt alle Funktionen, die Chat AI über die grundlegende Textgenerierung hinaus erweitern und anpassen.
Mit diesen Funktionen können Sie die Persönlichkeit des Assistenten gestalten, externe Wissensquellen integrieren und das Modellverhalten für unterschiedliche Anwendungsfälle konfigurieren.
Die Versionsgeschichte wird hier ebenfalls verfolgt, um nachzuvollziehen, welche Funktionen in welcher Version hinzugefügt oder aktualisiert wurden.
Verfügbare Funktionen Speicher Speicher sind Informationen, die der Chatbot aus dem Gespräch lernt, um sich personalisierter zu verhalten. Personas
Definieren Sie Rollen und Tonarten für den Assistenten (z. B. Vorstellungsgesprächsinterviewer, Tutor, informeller Stil).
Mit Personas können Sie das Verhalten des Modells schnell wechseln. Arcana / Retrieval-Augmented Generation (RAG)
Verbinden Sie Ihre eigenen Datenquellen (Dokumente, Notizen, Datensätze), um Antworten auf faktische Kontexte zu stützen. Tools
Chat AI-Modelle erhalten Zugriff auf verschiedene Tools, um nicht-textbasierte Aufgaben zu erfüllen oder die Antworten zu verbessern: Web-Suche Bildgenerierung Bildbearbeitung Text-zu-Sprache (TTS) MCP-Unterstützung
Sie können benutzerdefinierte öffentliche Model Context Protocol (MCP)-Server zu Chat AI hinzufügen.</description></item><item><title>Kommerzielle Modelle</title><link>https://docs.ai.gwdg.de/user/ai-services/commercial-models/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/commercial-models/index.html</guid><description>GWDG bietet Zugang zu ausgewählten kommerziellen Grundmodellen (z. B. OpenAI GPT, Anthropic Claude) über Microsoft Azure oder direkt über Anthropic Enterprise-Lizenzen.
Für den Zugriff auf KI-Modelle über SAIA, einschließlich lokal gehosteter und externer Modelle, siehe SAIA.
Dieser Abschnitt dokumentiert den Zugriff auf das kommerzielle Angebot und die dazugehörigen Agenten-Coding-Werkzeuge.
Warnung Kommerzielle Modelle sind externe Cloud-Dienste.
Gehen Sie nicht davon aus, dass dieselben Garantien für Datenlokalisierung gelten wie bei lokal gehosteten Diensten wie SAIA.
KI-Systeme können Halluzinationen erzeugen, und sensible oder vertrauliche Daten sollten nur verarbeitet werden, wenn dies für Ihren Anwendungsfall erlaubt ist.</description></item><item><title>Model Context Protocol (MCP)</title><link>https://docs.ai.gwdg.de/user/ai-services/chat-ai/features/mcp/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/chat-ai/features/mcp/index.html</guid><description>Chat AI unterstützt die Hinzufügung öffentlicher Model Context Protocol (MCP)-Server als Werkzeuganbieter zu Ihrer Chat AI-Erfahrung.
Dieses Tool erfordert eine Modell-Kontext-Protokoll-Server-URL, die eine einfache HTTPS-Adresse sein sollte.
Grundsätzlich ermöglicht dies, dass Chat AI mit zusätzlichen Werkzeugen, Datenquellen oder weiteren Verarbeitungsfunktionen interagiert, die über die in Chat AI integrierten Funktionen hinausgehen.
Alle Daten aus Ihrem Chat AI-Kontext können an den von Ihnen eingegebenen Server gesendet werden.
Die Interaktion mit aktuellen Informationen ist besonders nützlich für die Verarbeitung, da sie präzisere Ergebnisse liefert als Web-Suchen und weniger statisch ist als RAG-Systeme wie Arcana.
Darüber hinaus können zusätzliche Werkzeuge auf diese Weise genutzt werden, beispielsweise:</description></item><item><title>Öffentliche Arcana-Links</title><link>https://docs.ai.gwdg.de/user/ai-services/arcana/public-arcanas/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/arcana/public-arcanas/index.html</guid><description>Warnung Dieser Dienst befindet sich derzeit in der Beta-Phase und wird regelmäßig aktualisiert.
Das gilt auch für die Dokumentation.
Hier finden Sie eine Liste öffentlicher Links zu Arcanas.
Die Links sind nach Kategorien sortiert und enthalten öffentliche Inhalte.
Bitte ziehen Sie den Abschnitt „So verwenden Sie Arcana“ heran, falls Sie Hilfe bei der Nutzung benötigen.
GWDG-Dienste Enthält Wissen über die GWDG-Dienste und Dokumentation. Beispiel-Frage: Welche Dienste könnte ich als Forscher bei der GWDG nutzen? Institut für Informatik Enthält Wissen über den Studiengang Informatik. Beispiel-Frage: Wie funktioniert der Studiengang angewandte Informatik? Falls Sie einen defekten Link finden, teilen Sie uns dies bitte über unsere Support-Kontakte mit.</description></item><item><title>Support und FAQ</title><link>https://docs.ai.gwdg.de/user/ai-services/arcana/support/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/arcana/support/index.html</guid><description>Warnung Dieser Dienst befindet sich derzeit in der Beta-Phase und wird regelmäßig aktualisiert.
Das gilt auch für die Dokumentation.
Wenn Sie Probleme bei der Nutzung dieses Dienstes haben, kontaktieren Sie bitte unseren KISSKI-Support.
Wir benötigen außerdem Ihre Unterstützung, um öffentlich verfügbare Arcana-Links bereitzustellen.
Falls Sie einen Link haben, den Sie für eine größere Nutzergruppe relevant finden, kontaktieren Sie uns bitte, damit wir ihn veröffentlichen können.</description></item><item><title>Versionen</title><link>https://docs.ai.gwdg.de/user/ai-services/chat-ai/features/versionen/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/chat-ai/features/versionen/index.html</guid><description>Diese Seite listet alle Chat AI-Veröffentlichungen auf, beginnend mit der neuesten.
Jeder Eintrag beschreibt neue Funktionen, Verbesserungen und Fehlerbehebungen mit kurzen Erklärungen, wie sie genutzt werden können.
v0.9.0 — September 2025 Neue Funktionen Neu gestaltete Benutzeroberfläche
Eine frische Oberfläche mit ein- und ausklappbaren Seitenleisten links und rechts für maximale Gesprächsfläche.
Optimiert für die reibungslose Handhabung beliebig langer Gespräche und Anhänge.</description></item><item><title>Werkzeuge</title><link>https://docs.ai.gwdg.de/user/ai-services/chat-ai/features/tools/index.html</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://docs.ai.gwdg.de/user/ai-services/chat-ai/features/tools/index.html</guid><description>Übersicht Dieses Dokument beschreibt einen benutzerdefinierten, multimodalen Werkzeug-Server, der auf der GWDG-Infrastruktur gehostet wird. Er bietet zentrale KI-Funktionen: Bildgenerierung, Bildbearbeitung, Text-zu-Sprache (TTS) und Web-Suche, die direkt über die Chat AI-Oberfläche zugänglich sind. Diese Werkzeuge sind darauf ausgelegt, die Benutzerinteraktion zu bereichern, indem sie die dynamische Erstellung und Transformation von Medien innerhalb von Gesprächsworkflows ermöglichen.
Voraussetzungen Um den Werkzeug-Server nutzen zu können, müssen folgende Bedingungen erfüllt sein:</description></item></channel></rss>