← Zurück zur Startseite
Modellkatalog

Verfügbare KI-Modelle

Ein Überblick über die KI-Modelle, die sich in eine DSGPT-Unternehmensinstanz einbinden lassen – von Chat & Reasoning über Coding-Agenten, Open-Weight und RAG bis zu Voice, Bild und Video. Keine reine Modellliste, sondern eine Multi-Model-, RAG-, Voice-, Bild- und Private-Cloud-fähige KI-Infrastruktur.

55 Modelle 10 Kategorien EU- & Self-Hosting-Optionen

Premium Reasoning & Wissensarbeit

Stärkste Modelle für anspruchsvolle Analyse, Strategie und komplexe Wissensarbeit.

OpenAI

GPT-5.5 Pro

Frontier-Modell für die anspruchsvollsten Reasoning- und Analyseaufgaben.

Reasoning
OpenAI

GPT-5.5

Aktuelle Premium-Stufe für Wissensarbeit, Recherche und komplexe Texte.

Anthropic

Claude Opus 4.8

Stärkstes Opus-Modell für tiefe Analyse und lange Kontexte.

1M Kontext
Google

Gemini 3.1 Pro

Multimodales Spitzenmodell mit sehr großem Kontextfenster.

Multimodal
xAI

Grok 4.3

Aktuelle Grok-Generation – von xAI für die meisten Fälle empfohlen.

Standard-Modelle für den Unternehmensalltag

Das ausgewogene Verhältnis aus Leistung, Tempo und Kosten für den täglichen Einsatz.

OpenAI

GPT-5.4

Robustes Allround-Modell für den produktiven Arbeitsalltag.

OpenAI

GPT-5.4 mini

Schnelles, günstigeres Modell für Standardaufgaben in hoher Frequenz.

Anthropic

Claude Sonnet 4.6

Schnelle, intelligente Stufe für Text, Analyse und Code.

Google

Gemini 3.5 Flash

1M-Kontext mit multimodalen Inputs bei hohem Tempo.

1M Kontext
Mistral

Mistral Medium 3.5

EU-naher Allrounder für den Geschäftsalltag.

EU

Kosteneffizient & High Volume

Günstige, schnelle Modelle für Massenanfragen, Klassifizierung und einfache Aufgaben.

OpenAI

GPT-5.4 nano

Sehr günstig und schnell für einfache, hochfrequente Aufgaben.

Anthropic

Claude Haiku 4.5

Schnelles, kostengünstiges Modell für Routineaufgaben.

Mistral

Mistral Small 4

Kompaktes EU-Modell mit gutem Preis-Leistungs-Verhältnis.

EU
Mistral

Ministral 3

Sehr kleine Modellfamilie (14B/8B/3B) für schlanke Setups.

EU Open-Weight
Microsoft

Phi-4-mini

Kosteneffizientes Small-Language-Model für Edge-nahe Szenarien.

Open-Weight

Coding-Agenten

Spezialisierte Modelle für Softwareentwicklung, Tooling und Agenten-Workflows.

OpenAI

GPT-5.3-Codex

Auf Code-Generierung und agentische Entwicklung optimiert.

Mistral

Devstral 2

EU-Modell für Coding-Aufgaben und Entwickler-Workflows.

EU
Alibaba

Qwen3-Coder

Open-Weight-Coder für Self-Hosting und Coding-Agenten.

Open-Weight

Self-Hosted, Open-Weight & Private Cloud

Offene Modelle für maximale Datenhoheit – im eigenen Rechenzentrum oder der Private Cloud.

OpenAI

GPT-OSS 120B / 20B

Offene OpenAI-Modelle für den Betrieb in eigener Infrastruktur.

Open-Weight
Meta

Llama 4 Scout

Effizientes Open-Weight-Modell für Self-Hosting.

Open-Weight
Meta

Llama 4 Maverick

Leistungsstarkes Open-Weight-Modell für anspruchsvollere Aufgaben.

Open-Weight
DeepSeek

DeepSeek V4-Pro

1M-Kontext-Generation für lange Dokumente und Codebasen.

1M Kontext Open-Weight
Alibaba

Qwen3.5-Omni

Omni-multimodales Open-Weight-Modell für vielseitige Szenarien.

Open-Weight
Mistral

Mistral Large 3

Großes EU-Modell, auch selbst hostbar.

EU Open-Weight
Microsoft

Phi-4-reasoning

Kompaktes Reasoning-Modell für lokale, kosteneffiziente Setups.

Open-Weight
Aleph Alpha

Pharia-1

Europäisches Modell für souveräne, unternehmenskritische Umgebungen.

EU Souverän

RAG, Suche & Wissensdatenbanken

Embeddings und Reranking als Infrastruktur für interne Wissensquellen und semantische Suche.

OpenAI

text-embedding-3-large

Hochwertige Embeddings für präzise semantische Suche.

Embedding
OpenAI

text-embedding-3-small

Kosteneffiziente Embeddings für große Datenmengen.

Embedding
Google

Gemini Embedding 2

Embeddings für RAG-Pipelines im Google-Ökosystem.

Embedding
Cohere

Embed v4.0

Mehrsprachige Enterprise-Embeddings für Suche und RAG.

Embedding
Cohere

Rerank v4

Reranking für deutlich relevantere Suchergebnisse.

Rerank
Cohere

Command A+

Enterprise-LLM mit starkem Fokus auf RAG und mehrsprachige Anwendungen.

Mistral

Mistral Embed

EU-Embeddings für datenschutznahe RAG-Setups.

EU Embedding

Dokumente, OCR & Compliance

Dokumentenverarbeitung, Texterkennung sowie Moderation und Guardrails.

Mistral

Mistral OCR 3

Texterkennung und Strukturierung aus Dokumenten und Scans.

EU OCR
OpenAI

omni-moderation

Moderationsmodell zur Erkennung problematischer Inhalte.

Moderation
Mistral

Mistral Moderation 2

EU-Moderationsmodell für Inhaltsprüfung und Compliance.

EU Moderation
Meta

Llama Guard 4

Open-Weight-Guardrail zur Absicherung von Ein- und Ausgaben.

Open-Weight Guardrail
Meta

Llama Prompt Guard 2

Schutz vor Prompt-Injection und manipulativen Eingaben.

Open-Weight Guardrail

Voice, Telefonie & Realtime

Sprachein- und -ausgabe für Voicebots, Meeting-Transkription, Telefonie und Dolmetschen.

OpenAI

GPT-Realtime-2

Echtzeit-Sprachmodell für Voicebots und Telefonie.

Realtime
OpenAI

GPT-Realtime-Translate

Echtzeit-Dolmetschen über Sprachgrenzen hinweg.

Realtime
OpenAI

GPT-Realtime-Whisper

Schnelle, präzise Sprache-zu-Text-Transkription in Echtzeit.

Speech-to-Text
OpenAI

GPT-4o Transcribe Diarize

Transkription mit Sprechertrennung für Meetings.

Speech-to-Text
OpenAI

TTS-1 HD

Natürliche Sprachausgabe (Text-to-Speech) in hoher Qualität.

Text-to-Speech
Mistral

Voxtral TTS

EU-Sprachausgabe für datenschutznahe Audio-Workflows.

EU Text-to-Speech
ElevenLabs

ElevenLabs TTS

Realistische Stimmen für Text-to-Speech und Voice-Generierung.

Text-to-Speech
Cohere

Cohere Transcribe

Transkription für mehrsprachige Enterprise-Szenarien.

Speech-to-Text

Bildgenerierung & -bearbeitung

Aktuelle Bildmodelle für Entwürfe, Varianten und gezieltes Editing.

OpenAI

GPT Image 2

Aktuelles OpenAI-Bildmodell für Generierung und Bearbeitung.

Bild
Google

Imagen 4 Ultra

Höchste Qualitätsstufe der Imagen-Bildmodelle.

Bild
Google

Gemini 3.1 Flash Image

Schnelle multimodale Bildgenerierung („Nano Banana").

Bild
Black Forest Labs

FLUX.2

Hochwertige Bildgenerierung und Editing.

Bild
Black Forest Labs

FLUX.1 Kontext

Kontextbasiertes Bild-Editing mit hoher Kontrolle.

Bild

Video & Audio

Videogenerierung mit synchronisiertem Audio sowie Musik- und Audiomodelle.

OpenAI

Sora 2

Videogenerierung mit synchronisiertem Audio.

Video
OpenAI

Sora 2 Pro

Hochwertige Videogenerierung für anspruchsvollere Produktionen.

Video
Google

Veo 3.1

Aktuelle Generation der Veo-Videomodelle.

Video
Google

Lyria 3

Musik- und Audiogenerierung.

Audio
Hinweis: Welche Modelle in Ihrer DSGPT-Instanz sinnvoll sind, richtet sich nach Ihren fachlichen Anforderungen, Datenschutzvorgaben und wirtschaftlichen Rahmenbedingungen. Modellverfügbarkeit und -bezeichnungen der Anbieter ändern sich laufend; ältere Generationen lassen sich bei Bedarf weiterhin als Legacy-Option betreiben. EU- und Open-Weight-Modelle eignen sich besonders für souveräne und selbst gehostete Setups.
Beratung

Welche Modelle passen zu Ihrem Anwendungsfall?

Wir stellen für Ihre DSGPT-Instanz eine passende Modellstrategie zusammen – datenschutzbewusst, kosteneffizient und auf Ihre Aufgaben zugeschnitten. Lassen Sie uns gemeinsam die richtige Kombination aus Chat, RAG, Voice, Bild und Self-Hosting finden.

Kontakt aufnehmen +49 40 743 023 37 Termin buchen