Verwaltete Modelle
Modelle, die heute in Digio erhältlich sind
Weisen Sie pro Agent ein Standardmodell zu oder überschreiben Sie es pro Aufgabe. Die Nutzung wird in Digio-Tokens aus Ihrem Planguthaben gemessen – dem gleichen Wallet, egal ob der Agent Sonnet, GPT-4o oder Gemini Flash anruft.
Anthropischer Claude
-
Claude Opus 4.7
Flaggschiff-Argumentation, langer Kontext, Architektur- und Strategiearbeit.
-
Claude Opus 4.6
Opus der vorherigen Generation für stabile, qualitativ hochwertige Analysen.
-
Claude Sonnet 4.6
Täglicher Treiber – Codierung, Schreiben und mehrstufige Agentenschleifen.
-
Claude Sonnet 4.5 / 4
Schnelle Sonnet-Stufen mit sofortigem Caching für unterstützte Workloads.
-
Claude Haiku 4.5
Entwürfe, Klassifizierung und Unteraufgaben mit hohem Volumen mit geringer Latenz.
B2B-SaaS-Website-UI-Label. Übersetzen ins Natürliche von: OpenAI
-
GPT-5.5 / GPT-5.4 / GPT-5.2
Neueste GPT-5-Familie für allgemeine und Agenten-Workloads.
-
GPT-4.1 & GPT-4o
Zuverlässiger multimodaler Chat und Tool-Einsatz für Produktionsmitarbeiter.
-
GPT-4o mini
Kosteneffizientes Routing für Zusammenfassungen und einfache Schritte.
-
o3 / o3-pro / o3-mini / o4-mini
Argumentationsorientierte Modelle für Mathematik, Planung und Verifizierung.
-
GPT-5.3 Codex & Codex mini
Codegenerierung, Refactors und Repo-fähige Agentenfähigkeiten.
B2B-SaaS-Website-UI-Label. Ins Natürliche übersetzen: Google Gemini
-
Gemini 2.5 Pro
Langkontextrecherche und strukturierte Extraktion.
-
Gemini 2.5 Flash
Agentenschritte mit hohem Durchsatz und wettbewerbsfähigen Token-Raten.
-
Gemini 2.0 Flash
Ultraschnelle Durchläufe für Parsing, Tagging und Batch-Jobs.
Offene und spezielle APIs
-
DeepSeek Chat & Reasoner
Großer Wert für Chat- und Gedankenkettenaufgaben.
-
Mistral Large
In Europa gehostete Option für mehrsprachige Agententeams.
-
Llama 3.3 70B
Open-Weights-Klassenmodell über API – lässt sich gut mit privater GPU kombinieren.
-
Grok 3
Echtzeitorientiertes Modell für Nachrichten- und Social-Monitoring-Agenten.
-
Sonar Pro
Suchbasierte Antworten für Forschungsagenten.
-
Command R+
RAG-freundliche Unternehmens-Chat- und Abruf-Workflows.
Model list and token economics evolve with provider releases. Your workspace shows live options when you assign a model to an agent; Digio Tokens debit from the same balance as in
pricing.
Bringen Sie Ihr eigenes Modell mit
Installieren und verbinden Sie ein benutzerdefiniertes Modell
Typisches Setup von Null bis Agenten, die Ihren Endpunkt anrufen:
-
1
GPU reservieren
Wählen Sie VRAM, Region und Betriebszeit (Burst vs. Always-On). Der Stauraum für Gewichte wird mit der Instanz geliefert oder ist auf Ihrem Eimer montiert.
-
2
Stellen Sie den Stapel bereit
Starten Sie ein Bereitstellungsimage oder SSH, installieren Sie CUDA-Treiber und laden Sie Prüfpunkte. Gesundheitschecks bestätigen, dass das Modell bereit ist.
-
3
Endpunkt registrieren
Fügen Sie in den Arbeitsbereichseinstellungen Basis-URL, API-Schlüssel und Modell-ID hinzu. Digio validiert Latenz und Token-Format, bevor es live geht.
-
4
Den Agenten zuweisen
Wählen Sie Ihr Privatmodell als Standard für ausgewählte Agenten; Verwaltete Claude/GPT-Modelle bleiben weiterhin nebeneinander verfügbar.
Die GPU-Miete wird separat von den Digio-Plan-Abonnements abgerechnet. Kontaktieren Sie uns für Kapazitätsplanung, SLAs und Migration von einem vorhandenen Inferenzcluster.