Choix de modèle et configuration Provider
NOTE
À propos de cette page : Cette page explique en détail comment choisir le bon modèle IA, configurer les Providers, gérer les clés API, et optimiser les coûts.
I. Aperçu des modèles IA
MBAgent prend en charge plusieurs fournisseurs de modèles IA (Provider), vous permettant de choisir librement le modèle le mieux adapté à vos besoins.
Fournisseurs pris en charge
| Fournisseur | Modèles représentatifs | Caractéristiques |
|---|---|---|
| Houniao officiel | deepseek-v4-flash, deepseek-v4-pro, gpt-5-mini, gpt-5.6, gpt-6.0-sol, claude-sonnet-4, claude-opus-4.5, gemini-2.5-flash, gemini-2.5-pro | Intégré à Houniao, facturation unifiée, support prioritaire |
| OpenAI | gpt-5-mini, gpt-5-nano, gpt-5.6, gpt-6.0, gpt-6.0-sol | Modèles puissants, écosystème mature |
| Anthropic | claude-sonnet-4, claude-opus-4.5 | Excellent en raisonnement et en codage |
| gemini-2.5-flash, gemini-2.5-pro | Très grande fenêtre de contexte (2M) | |
| DeepSeek | deepseek-v4-flash, deepseek-v4-pro | Économique, performances solides |
| Personnalisé | Compatible avec l'API OpenAI | Auto-hébergé ou passerelle tierce |
II. Catalogue des modèles Houniao officiels
TIP
Modèles officiels Houniao (recommandés) : intégration profonde avec le navigateur Houniao, facturation unifiée, support technique prioritaire.
Modèles économiques (adaptés aux tâches simples)
| Modèle | Fenêtre de contexte | Caractéristiques | Cas d'usage |
|---|---|---|---|
| deepseek-v4-flash | 128K | Ultra-économique, rapide | Conversations simples, traitement de texte |
| gpt-5-mini | 128K | Économique, polyvalent | Tâches quotidiennes |
| gpt-5-nano | 64K | Le plus économique, ultra-rapide | Tâches très simples |
| gemini-2.5-flash | 1M | Très grande fenêtre, économique | Documents longs |
Modèles principaux (adaptés à la plupart des tâches)
| Modèle | Fenêtre de contexte | Caractéristiques | Cas d'usage |
|---|---|---|---|
| deepseek-v4-pro | 128K | Excellent rapport qualité-prix, recommandé | Codage, rédaction, analyse |
| claude-sonnet-4 | 200K | Excellent en raisonnement | Analyse complexe, codage |
| gpt-5.6 | 128K | Polyvalent | Tâches générales |
| gemini-2.5-pro | 2M | Énorme fenêtre de contexte | Analyse de documents massifs |
Modèles phares (adaptés aux tâches complexes)
| Modèle | Fenêtre de contexte | Caractéristiques | Cas d'usage |
|---|---|---|---|
| gpt-6.0-sol | 256K | Le plus puissant, raisonnement profond | Recherche, mathématiques, codage |
| claude-opus-4.5 | 200K | Raisonnement profond, créatif | Créativité, analyse |
| gpt-6.0 | 256K | Le plus complet | Toutes tâches complexes |
Modèles spéciaux
| Modèle | Caractéristiques | Cas d'usage |
|---|---|---|
| deepseek-v4-vision | Traitement d'images | Analyse d'images, OCR |
| deepseek-v4-coder | Optimisé pour le code | Génération de code, revue |
III. Comment choisir le bon modèle ?
Choisir selon le type de tâche
| Type de tâche | Modèle recommandé | Raison |
|---|---|---|
| Conversation simple | deepseek-v4-flash / gpt-5-mini | Économique et rapide |
| Codage quotidien | deepseek-v4-pro / claude-sonnet-4 | Bon en code |
| Analyse de documents | gemini-2.5-pro | Grande fenêtre de contexte |
| Recherche complexe | gpt-6.0-sol / claude-opus-4.5 | Raisonnement puissant |
| Traitement d'images | deepseek-v4-vision | Support natif d'images |
| Créativité | claude-opus-4.5 / gpt-6.0 | Plus créatif |
| Multilingue | gpt-5.6 / claude-sonnet-4 | Bon support multilingue |
Choisir selon le budget
| Budget | Modèle recommandé | Coût estimé |
|---|---|---|
| Économique | deepseek-v4-flash, gpt-5-nano | ¥0,001-0,01 / 1K tokens |
| Moyen | deepseek-v4-pro, gpt-5-mini | ¥0,01-0,05 / 1K tokens |
| Confortable | claude-sonnet-4, gpt-5.6 | ¥0,05-0,20 / 1K tokens |
| Premium | gpt-6.0-sol, claude-opus-4.5 | ¥0,20-1,00 / 1K tokens |
Stratégie de combinaison recommandée
Stratégie 1 : Modèle unique
- Convient aux débutants
- Choisissez un modèle principal (recommandé :
deepseek-v4-pro)
Stratégie 2 : Double modèle (recommandée)
- Modèle par défaut :
deepseek-v4-flash(tâches quotidiennes) - Modèle amélioré :
gpt-6.0-solouclaude-opus-4.5(tâches complexes) - Basculez selon les besoins
Stratégie 3 : Multi-modèles spécialisés
- Conversation :
deepseek-v4-flash - Codage :
deepseek-v4-pro - Vision :
deepseek-v4-vision - Analyse :
gemini-2.5-pro - Recherche :
gpt-6.0-sol
IV. Configuration du Provider
1. Houniao officiel (recommandé)
Avantages
- ✅ Intégré au navigateur Houniao, aucune configuration supplémentaire nécessaire
- ✅ Facturation unifiée via Houniao
- ✅ Support technique prioritaire
- ✅ Crédits赠 inclus pour les comptes Houniao
Étapes de configuration
- Ouvrez la console Houniao : https://www.mbbrowser.com/console
- Connectez-vous à votre compte Houniao
- Allez dans Mon compte → Crédits IA → Créer une clé
- Copiez la clé générée
- Dans MBAgent : Paramètres → Provider → Houniao officiel
- Collez la clé API
- Cliquez sur "Vérifier"
- Une fois la vérification réussie, enregistrez
Affichage des crédits
- Dans MBAgent, le coin supérieur droit affiche les crédits restants
- Vous pouvez aussi aller dans Paramètres → Provider pour voir les détails
- Ou consultez directement la console Houniao
NOTE
Voir les crédits IA : Vous pouvez consulter vos crédits IA actuels dans la console Houniao (https://www.mbbrowser.com/console → Mon compte → Crédits IA), ou via le menu déroulant du compte en haut à droite de l'onglet de chat.
2. OpenAI
Avantages
- ✅ Modèles puissants et écosystème mature
- ✅ Stable et fiable
- ❌ Nécessite un accès Internet international
- ❌ Paiement en USD
Étapes de configuration
- Obtenez une clé API sur https://platform.openai.com/api-keys
- Dans MBAgent : Paramètres → Provider → OpenAI
- Saisissez la clé API
- (Optionnel) Configurez un proxy si nécessaire
- Cliquez sur "Vérifier"
3. Anthropic
Avantages
- ✅ Excellent en raisonnement et en codage
- ✅ Compréhension contextuelle forte
- ❌ Nécessite un accès Internet international
- ❌ Paiement en USD
Étapes de configuration
- Obtenez une clé API sur https://console.anthropic.com/settings/keys
- Dans MBAgent : Paramètres → Provider → Anthropic
- Saisissez la clé API
- (Optionnel) Configurez un proxy si nécessaire
- Cliquez sur "Vérifier"
4. Google Gemini
Avantages
- ✅ Fenêtre de contexte énorme (jusqu'à 2M tokens)
- ✅ Prix abordable
- ❌ Nécessite un accès Internet international
- ❌ Paiement en USD
Étapes de configuration
- Obtenez une clé API dans Google AI Studio (https://aistudio.google.com)
- Dans MBAgent : Paramètres → Provider → Google
- Saisissez la clé API
- Cliquez sur "Vérifier"
5. Provider personnalisé
Scénarios applicables
- Auto-hébergé (par exemple Ollama, vLLM)
- Passerelle IA tierce (par exemple NEWAPI)
- Proxy inverse interne à l'entreprise
Étapes de configuration
- Paramètres → Provider → Ajouter un Provider personnalisé
- Remplissez :
- Nom : Nom personnalisé (par exemple "Passerelle interne")
- URL de base : URL de l'API (par exemple
https://ai.ehouniao.com/v1) - Clé API : Votre clé
- (Optionnel) Modèles personnalisés :
- Nom du modèle : Le nom exact du modèle
- Fenêtre de contexte : Taille de la fenêtre
- Cliquez sur "Vérifier"
- Une fois réussi, enregistrez
Compatibilité
Tout service compatible avec l'API OpenAI est pris en charge, incluant :
- Ollama
- vLLM
- LocalAI
- FastChat
- NEWAPI
- OneAPI
- etc.
V. Gestion des clés API
Sécurité des clés
IMPORTANT
Mécanisme de sécurité des clés API :
- Les clés ne sont pas téléchargées sur un serveur
- Stockage localisé dans le Windows Credential Manager
- L'interface n'affiche que des masques (par exemple
sk-***abc) - Désinstallation de MBAgent = nettoyage des clés
Visualisation et modification
- Paramètres → Provider
- Sélectionnez le Provider à gérer
- Vous pouvez :
- Voir le masque de la clé
- Modifier la clé
- Supprimer la clé
- Tester la connexion
Clés multiples
- Différents Providers peuvent avoir des clés différentes
- Vous pouvez configurer plusieurs clés pour le même Provider (pour la rotation)
- Une clé = un quota indépendant
Rotation des clés
Recommandation : faites pivoter vos clés tous les 3-6 mois pour des raisons de sécurité :
- Créez une nouvelle clé sur le site du Provider
- Configurez la nouvelle clé dans MBAgent
- Vérifiez que la nouvelle clé fonctionne
- Supprimez l'ancienne clé
- Supprimez l'ancienne clé sur le site du Provider
VI. Routage intelligent
Qu'est-ce que le routage intelligent ?
Le routage intelligent sélectionne automatiquement le modèle le plus approprié en fonction du type de tâche :
Tâche simple → Modèle économique
Tâche moyenne → Modèle principal
Tâche complexe → Modèle phareConfiguration du routage
- Paramètres → Provider → Routage intelligent
- Activez le routage intelligent
- Configurez les règles :
Tâches de conversation → deepseek-v4-flash
Tâches de codage → deepseek-v4-pro
Tâches d'analyse → gemini-2.5-pro
Tâches de recherche → gpt-6.0-sol
Tâches d'images → deepseek-v4-visionAvantages
- ✅ Économise les coûts (les tâches simples utilisent des modèles peu coûteux)
- ✅ Améliore la qualité (les tâches complexes utilisent des modèles puissants)
- ✅ Automatique, aucune intervention manuelle nécessaire
VII. Optimisation des coûts
1. Choisir le bon modèle
- Pour les tâches simples, n'utilisez pas de modèles coûteux
- Basculez vers des modèles plus économiques après les tests
2. Définir le budget des tâches
Voir Aperçu des paramètres pour les détails.
3. Fermer les fonctions inutiles
- Fermer l'affichage du processus de réflexion (économise les tokens)
- Fermer les statistiques de tokens (économise l'affichage)
- Limiter la fenêtre de contexte
4. Utiliser le cache
- Activer le cache de préfixe (si pris en charge par le modèle)
- Réutiliser les prompts courants
5. Surveiller l'utilisation
- Vérifier régulièrement la consommation de tokens
- Identifier les tâches qui consomment beaucoup
- Optimiser les prompts trop longs
VIII. Problèmes courants
Q1 : "Échec de l'authentification API"
Causes possibles :
- Clé API invalide ou expirée
- Clé mal copiée (espaces, sauts de ligne)
- Compte sans crédits
Solutions :
- Régénérez une clé
- Vérifiez qu'il n'y a pas d'espace
- Vérifiez les crédits du compte
Q2 : Le modèle est très lent
Causes possibles :
- Réseau lent
- Charge élevée du modèle
- Modèle surdimensionné
Solutions :
- Passez à un modèle plus petit
- Vérifiez le réseau
- Essayez à un autre moment
Q3 : Réponse tronquée
Cause : La fenêtre de contexte est dépassée
Solutions :
- Démarrez une nouvelle session
- Compressez l'historique
- Utilisez un modèle à fenêtre de contexte plus grande
Q4 : Comment passer rapidement d'un modèle à l'autre ?
A : Cliquez sur le sélecteur de modèle dans la barre supérieure, sélectionnez un autre modèle, le changement prend effet immédiatement.
Q5 : Puis-je utiliser simultanément plusieurs Providers ?
A : Oui. Vous pouvez configurer plusieurs Providers et basculer librement.
IX. Prochaines étapes
- 📘 Panneau de tâches - Lancer des tâches prédéfinies
- 📘 Aperçu des paramètres - Configurer les paramètres détaillés
- 📘 Utilisation de la banque de mémoire IA - Mémoriser vos préférences
TIP
Recommandations pour économiser de l'argent :
- Les tâches quotidiennes utilisent
deepseek-v4-flash(le plus économique) - Le codage utilise
deepseek-v4-pro(le plus rentable) - Les tâches complexes utilisent temporairement
gpt-6.0-sol - Évitez d'utiliser
claude-opus-4.5pour des tâches simples
