Modèles gérés
Modèles disponibles chez Digio aujourd'hui
Attribuez un modèle par défaut par agent ou remplacez par tâche. L'utilisation est mesurée en jetons Digio à partir du solde de votre forfait : le même portefeuille, que l'agent appelle Sonnet, GPT-4o ou Gemini Flash.
Claude Anthropique
-
Claude Opus 4.7
Raisonnement phare, contexte long, travail d'architecture et de stratégie.
-
Claude Opus 4.6
Opus de génération précédente pour une analyse stable et de haute qualité.
-
Claude Sonnet 4.6
Pilote quotidien : codage, écriture et boucles d'agent en plusieurs étapes.
-
Claude Sonnet 4.5 / 4
Niveaux Sonnet rapides avec mise en cache rapide sur les charges de travail prises en charge.
-
Claude Haiku 4.5
Brouillons à faible latence, classification et sous-tâches à volume élevé.
Étiquette d’interface utilisateur du site Web B2B SaaS. Traduire en fr naturel : OpenAI
-
GPT-5.5 / GPT-5.4 / GPT-5.2
Dernière famille GPT-5 pour les charges de travail générales et agents.
-
GPT-4.1 & GPT-4o
Chat multimodal fiable et utilisation d’outils pour les agents de production.
-
GPT-4o mini
Routage rentable pour les résumés et les étapes légères.
-
o3 / o3-pro / o3-mini / o4-mini
Modèles axés sur le raisonnement pour les mathématiques, la planification et la vérification.
-
GPT-5.3 Codex & Codex mini
Génération de code, refactorisation et compétences d'agent sensibles aux dépôts.
Google Gémeaux
-
Gemini 2.5 Pro
Recherche de contexte long et extraction structurée.
-
Gemini 2.5 Flash
Étapes d'agent à haut débit avec des taux de jetons compétitifs.
-
Gemini 2.0 Flash
Passes ultra-rapides pour l’analyse, le marquage et les tâches par lots.
API ouvertes et spécialisées
-
DeepSeek Chat & Reasoner
Forte valeur pour les tâches de type chat et chaîne de pensée.
-
Mistral Large
Option hébergée en Europe pour les équipes d'agents multilingues.
-
Llama 3.3 70B
Modèle de classe à pondération ouverte via API : se marie bien avec un GPU privé.
-
Grok 3
Modèle orienté temps réel pour les agents de nouvelles et de surveillance sociale.
-
Sonar Pro
Des réponses fondées sur la recherche pour les agents de recherche.
-
Command R+
Flux de travail de discussion et de récupération d'entreprise adaptés à RAG.
Model list and token economics evolve with provider releases. Your workspace shows live options when you assign a model to an agent; Digio Tokens debit from the same balance as in
pricing.
Apportez votre propre modèle
Installer et connecter un modèle personnalisé
Configuration typique de zéro jusqu'aux agents appelant votre point de terminaison :
-
1
Réserver le GPU
Choisissez la VRAM, la région et la disponibilité (en rafale ou en permanence). Le stockage des poids est livré avec l'instance ou monte votre seau.
-
2
Déployer la pile
Démarrez une image de diffusion ou SSH, installez les pilotes CUDA et chargez les points de contrôle. Les contrôles de santé confirment que le modèle est prêt.
-
3
Enregistrer le point de terminaison
Ajoutez l'URL de base, la clé API et l'ID de modèle dans les paramètres de l'espace de travail. Digio valide la latence et le format du jeton avant la mise en ligne.
-
4
Attribuer aux agents
Choisissez votre modèle privé comme modèle par défaut pour les agents sélectionnés ; Les modèles Claude/GPT gérés restent disponibles côte à côte.
La location du GPU est facturée séparément des abonnements au forfait Digio. Contactez-nous pour la planification de la capacité, les SLA et la migration à partir d'un cluster d'inférence existant.