Verfügbare KI-Modelle
Ein Überblick über die KI-Modelle, die sich in eine DSGPT-Unternehmensinstanz einbinden lassen – von Chat & Reasoning über Coding-Agenten, Open-Weight und RAG bis zu Voice, Bild und Video. Keine reine Modellliste, sondern eine Multi-Model-, RAG-, Voice-, Bild- und Private-Cloud-fähige KI-Infrastruktur.
Premium Reasoning & Wissensarbeit
Stärkste Modelle für anspruchsvolle Analyse, Strategie und komplexe Wissensarbeit.
GPT-5.5 Pro
Frontier-Modell für die anspruchsvollsten Reasoning- und Analyseaufgaben.
GPT-5.5
Aktuelle Premium-Stufe für Wissensarbeit, Recherche und komplexe Texte.
Claude Opus 4.8
Stärkstes Opus-Modell für tiefe Analyse und lange Kontexte.
Gemini 3.1 Pro
Multimodales Spitzenmodell mit sehr großem Kontextfenster.
Grok 4.3
Aktuelle Grok-Generation – von xAI für die meisten Fälle empfohlen.
Standard-Modelle für den Unternehmensalltag
Das ausgewogene Verhältnis aus Leistung, Tempo und Kosten für den täglichen Einsatz.
GPT-5.4
Robustes Allround-Modell für den produktiven Arbeitsalltag.
GPT-5.4 mini
Schnelles, günstigeres Modell für Standardaufgaben in hoher Frequenz.
Claude Sonnet 4.6
Schnelle, intelligente Stufe für Text, Analyse und Code.
Gemini 3.5 Flash
1M-Kontext mit multimodalen Inputs bei hohem Tempo.
Mistral Medium 3.5
EU-naher Allrounder für den Geschäftsalltag.
Kosteneffizient & High Volume
Günstige, schnelle Modelle für Massenanfragen, Klassifizierung und einfache Aufgaben.
GPT-5.4 nano
Sehr günstig und schnell für einfache, hochfrequente Aufgaben.
Claude Haiku 4.5
Schnelles, kostengünstiges Modell für Routineaufgaben.
Mistral Small 4
Kompaktes EU-Modell mit gutem Preis-Leistungs-Verhältnis.
Ministral 3
Sehr kleine Modellfamilie (14B/8B/3B) für schlanke Setups.
Phi-4-mini
Kosteneffizientes Small-Language-Model für Edge-nahe Szenarien.
Coding-Agenten
Spezialisierte Modelle für Softwareentwicklung, Tooling und Agenten-Workflows.
GPT-5.3-Codex
Auf Code-Generierung und agentische Entwicklung optimiert.
Devstral 2
EU-Modell für Coding-Aufgaben und Entwickler-Workflows.
Qwen3-Coder
Open-Weight-Coder für Self-Hosting und Coding-Agenten.
Self-Hosted, Open-Weight & Private Cloud
Offene Modelle für maximale Datenhoheit – im eigenen Rechenzentrum oder der Private Cloud.
GPT-OSS 120B / 20B
Offene OpenAI-Modelle für den Betrieb in eigener Infrastruktur.
Llama 4 Scout
Effizientes Open-Weight-Modell für Self-Hosting.
Llama 4 Maverick
Leistungsstarkes Open-Weight-Modell für anspruchsvollere Aufgaben.
DeepSeek V4-Pro
1M-Kontext-Generation für lange Dokumente und Codebasen.
Qwen3.5-Omni
Omni-multimodales Open-Weight-Modell für vielseitige Szenarien.
Mistral Large 3
Großes EU-Modell, auch selbst hostbar.
Phi-4-reasoning
Kompaktes Reasoning-Modell für lokale, kosteneffiziente Setups.
Pharia-1
Europäisches Modell für souveräne, unternehmenskritische Umgebungen.
RAG, Suche & Wissensdatenbanken
Embeddings und Reranking als Infrastruktur für interne Wissensquellen und semantische Suche.
text-embedding-3-large
Hochwertige Embeddings für präzise semantische Suche.
text-embedding-3-small
Kosteneffiziente Embeddings für große Datenmengen.
Gemini Embedding 2
Embeddings für RAG-Pipelines im Google-Ökosystem.
Embed v4.0
Mehrsprachige Enterprise-Embeddings für Suche und RAG.
Rerank v4
Reranking für deutlich relevantere Suchergebnisse.
Command A+
Enterprise-LLM mit starkem Fokus auf RAG und mehrsprachige Anwendungen.
Mistral Embed
EU-Embeddings für datenschutznahe RAG-Setups.
Dokumente, OCR & Compliance
Dokumentenverarbeitung, Texterkennung sowie Moderation und Guardrails.
Mistral OCR 3
Texterkennung und Strukturierung aus Dokumenten und Scans.
omni-moderation
Moderationsmodell zur Erkennung problematischer Inhalte.
Mistral Moderation 2
EU-Moderationsmodell für Inhaltsprüfung und Compliance.
Llama Guard 4
Open-Weight-Guardrail zur Absicherung von Ein- und Ausgaben.
Llama Prompt Guard 2
Schutz vor Prompt-Injection und manipulativen Eingaben.
Voice, Telefonie & Realtime
Sprachein- und -ausgabe für Voicebots, Meeting-Transkription, Telefonie und Dolmetschen.
GPT-Realtime-2
Echtzeit-Sprachmodell für Voicebots und Telefonie.
GPT-Realtime-Translate
Echtzeit-Dolmetschen über Sprachgrenzen hinweg.
GPT-Realtime-Whisper
Schnelle, präzise Sprache-zu-Text-Transkription in Echtzeit.
GPT-4o Transcribe Diarize
Transkription mit Sprechertrennung für Meetings.
TTS-1 HD
Natürliche Sprachausgabe (Text-to-Speech) in hoher Qualität.
Voxtral TTS
EU-Sprachausgabe für datenschutznahe Audio-Workflows.
ElevenLabs TTS
Realistische Stimmen für Text-to-Speech und Voice-Generierung.
Cohere Transcribe
Transkription für mehrsprachige Enterprise-Szenarien.
Bildgenerierung & -bearbeitung
Aktuelle Bildmodelle für Entwürfe, Varianten und gezieltes Editing.
GPT Image 2
Aktuelles OpenAI-Bildmodell für Generierung und Bearbeitung.
Imagen 4 Ultra
Höchste Qualitätsstufe der Imagen-Bildmodelle.
Gemini 3.1 Flash Image
Schnelle multimodale Bildgenerierung („Nano Banana").
FLUX.2
Hochwertige Bildgenerierung und Editing.
FLUX.1 Kontext
Kontextbasiertes Bild-Editing mit hoher Kontrolle.
Video & Audio
Videogenerierung mit synchronisiertem Audio sowie Musik- und Audiomodelle.
Sora 2
Videogenerierung mit synchronisiertem Audio.
Sora 2 Pro
Hochwertige Videogenerierung für anspruchsvollere Produktionen.
Veo 3.1
Aktuelle Generation der Veo-Videomodelle.
Lyria 3
Musik- und Audiogenerierung.
Welche Modelle passen zu Ihrem Anwendungsfall?
Wir stellen für Ihre DSGPT-Instanz eine passende Modellstrategie zusammen – datenschutzbewusst, kosteneffizient und auf Ihre Aufgaben zugeschnitten. Lassen Sie uns gemeinsam die richtige Kombination aus Chat, RAG, Voice, Bild und Self-Hosting finden.