Skip to content

Choix de modèle et configuration Provider ​

NOTE

À propos de cette page : Cette page explique en détail comment choisir le bon modèle IA, configurer les Providers, gérer les clés API, et optimiser les coûts.


I. Aperçu des modèles IA ​

MBAgent prend en charge plusieurs fournisseurs de modèles IA (Provider), vous permettant de choisir librement le modèle le mieux adapté à vos besoins.

Fournisseurs pris en charge ​

FournisseurModèles représentatifsCaractéristiques
Houniao officieldeepseek-v4-flash, deepseek-v4-pro, gpt-5-mini, gpt-5.6, gpt-6.0-sol, claude-sonnet-4, claude-opus-4.5, gemini-2.5-flash, gemini-2.5-proIntégré à Houniao, facturation unifiée, support prioritaire
OpenAIgpt-5-mini, gpt-5-nano, gpt-5.6, gpt-6.0, gpt-6.0-solModèles puissants, écosystème mature
Anthropicclaude-sonnet-4, claude-opus-4.5Excellent en raisonnement et en codage
Googlegemini-2.5-flash, gemini-2.5-proTrès grande fenêtre de contexte (2M)
DeepSeekdeepseek-v4-flash, deepseek-v4-proÉconomique, performances solides
PersonnaliséCompatible avec l'API OpenAIAuto-hébergé ou passerelle tierce

II. Catalogue des modèles Houniao officiels ​

TIP

Modèles officiels Houniao (recommandés) : intégration profonde avec le navigateur Houniao, facturation unifiée, support technique prioritaire.

Modèles économiques (adaptés aux tâches simples) ​

ModèleFenêtre de contexteCaractéristiquesCas d'usage
deepseek-v4-flash128KUltra-économique, rapideConversations simples, traitement de texte
gpt-5-mini128KÉconomique, polyvalentTâches quotidiennes
gpt-5-nano64KLe plus économique, ultra-rapideTâches très simples
gemini-2.5-flash1MTrès grande fenêtre, économiqueDocuments longs

Modèles principaux (adaptés à la plupart des tâches) ​

ModèleFenêtre de contexteCaractéristiquesCas d'usage
deepseek-v4-pro128KExcellent rapport qualité-prix, recommandéCodage, rédaction, analyse
claude-sonnet-4200KExcellent en raisonnementAnalyse complexe, codage
gpt-5.6128KPolyvalentTâches générales
gemini-2.5-pro2MÉnorme fenêtre de contexteAnalyse de documents massifs

Modèles phares (adaptés aux tâches complexes) ​

ModèleFenêtre de contexteCaractéristiquesCas d'usage
gpt-6.0-sol256KLe plus puissant, raisonnement profondRecherche, mathématiques, codage
claude-opus-4.5200KRaisonnement profond, créatifCréativité, analyse
gpt-6.0256KLe plus completToutes tâches complexes

Modèles spéciaux ​

ModèleCaractéristiquesCas d'usage
deepseek-v4-visionTraitement d'imagesAnalyse d'images, OCR
deepseek-v4-coderOptimisé pour le codeGénération de code, revue

III. Comment choisir le bon modèle ? ​

Choisir selon le type de tâche ​

Type de tâcheModèle recommandéRaison
Conversation simpledeepseek-v4-flash / gpt-5-miniÉconomique et rapide
Codage quotidiendeepseek-v4-pro / claude-sonnet-4Bon en code
Analyse de documentsgemini-2.5-proGrande fenêtre de contexte
Recherche complexegpt-6.0-sol / claude-opus-4.5Raisonnement puissant
Traitement d'imagesdeepseek-v4-visionSupport natif d'images
Créativitéclaude-opus-4.5 / gpt-6.0Plus créatif
Multilinguegpt-5.6 / claude-sonnet-4Bon support multilingue

Choisir selon le budget ​

BudgetModèle recommandéCoût estimé
Économiquedeepseek-v4-flash, gpt-5-nano¥0,001-0,01 / 1K tokens
Moyendeepseek-v4-pro, gpt-5-mini¥0,01-0,05 / 1K tokens
Confortableclaude-sonnet-4, gpt-5.6¥0,05-0,20 / 1K tokens
Premiumgpt-6.0-sol, claude-opus-4.5¥0,20-1,00 / 1K tokens

Stratégie de combinaison recommandée ​

Stratégie 1 : Modèle unique ​

  • Convient aux débutants
  • Choisissez un modèle principal (recommandé : deepseek-v4-pro)

Stratégie 2 : Double modèle (recommandée) ​

  • Modèle par défaut : deepseek-v4-flash (tâches quotidiennes)
  • Modèle amélioré : gpt-6.0-sol ou claude-opus-4.5 (tâches complexes)
  • Basculez selon les besoins

Stratégie 3 : Multi-modèles spécialisés ​

  • Conversation : deepseek-v4-flash
  • Codage : deepseek-v4-pro
  • Vision : deepseek-v4-vision
  • Analyse : gemini-2.5-pro
  • Recherche : gpt-6.0-sol

IV. Configuration du Provider ​

1. Houniao officiel (recommandé) ​

Avantages ​

  • ✅ Intégré au navigateur Houniao, aucune configuration supplémentaire nécessaire
  • ✅ Facturation unifiée via Houniao
  • ✅ Support technique prioritaire
  • ✅ Crédits赠 inclus pour les comptes Houniao

Étapes de configuration ​

  1. Ouvrez la console Houniao : https://www.mbbrowser.com/console
  2. Connectez-vous à votre compte Houniao
  3. Allez dans Mon compte → Crédits IA → Créer une clé
  4. Copiez la clé générée
  5. Dans MBAgent : Paramètres → Provider → Houniao officiel
  6. Collez la clé API
  7. Cliquez sur "Vérifier"
  8. Une fois la vérification réussie, enregistrez

Affichage des crédits ​

  • Dans MBAgent, le coin supérieur droit affiche les crédits restants
  • Vous pouvez aussi aller dans Paramètres → Provider pour voir les détails
  • Ou consultez directement la console Houniao

NOTE

Voir les crédits IA : Vous pouvez consulter vos crédits IA actuels dans la console Houniao (https://www.mbbrowser.com/console → Mon compte → Crédits IA), ou via le menu déroulant du compte en haut à droite de l'onglet de chat.

2. OpenAI ​

Avantages ​

  • ✅ Modèles puissants et écosystème mature
  • ✅ Stable et fiable
  • ❌ Nécessite un accès Internet international
  • ❌ Paiement en USD

Étapes de configuration ​

  1. Obtenez une clé API sur https://platform.openai.com/api-keys
  2. Dans MBAgent : Paramètres → Provider → OpenAI
  3. Saisissez la clé API
  4. (Optionnel) Configurez un proxy si nécessaire
  5. Cliquez sur "Vérifier"

3. Anthropic ​

Avantages ​

  • ✅ Excellent en raisonnement et en codage
  • ✅ Compréhension contextuelle forte
  • ❌ Nécessite un accès Internet international
  • ❌ Paiement en USD

Étapes de configuration ​

  1. Obtenez une clé API sur https://console.anthropic.com/settings/keys
  2. Dans MBAgent : Paramètres → Provider → Anthropic
  3. Saisissez la clé API
  4. (Optionnel) Configurez un proxy si nécessaire
  5. Cliquez sur "Vérifier"

4. Google Gemini ​

Avantages ​

  • ✅ Fenêtre de contexte énorme (jusqu'à 2M tokens)
  • ✅ Prix abordable
  • ❌ Nécessite un accès Internet international
  • ❌ Paiement en USD

Étapes de configuration ​

  1. Obtenez une clé API dans Google AI Studio (https://aistudio.google.com)
  2. Dans MBAgent : Paramètres → Provider → Google
  3. Saisissez la clé API
  4. Cliquez sur "Vérifier"

5. Provider personnalisé ​

Scénarios applicables ​

  • Auto-hébergé (par exemple Ollama, vLLM)
  • Passerelle IA tierce (par exemple NEWAPI)
  • Proxy inverse interne à l'entreprise

Étapes de configuration ​

  1. Paramètres → Provider → Ajouter un Provider personnalisé
  2. Remplissez :
    • Nom : Nom personnalisé (par exemple "Passerelle interne")
    • URL de base : URL de l'API (par exemple https://ai.ehouniao.com/v1)
    • Clé API : Votre clé
  3. (Optionnel) Modèles personnalisés :
    • Nom du modèle : Le nom exact du modèle
    • Fenêtre de contexte : Taille de la fenêtre
  4. Cliquez sur "Vérifier"
  5. Une fois réussi, enregistrez

Compatibilité ​

Tout service compatible avec l'API OpenAI est pris en charge, incluant :

  • Ollama
  • vLLM
  • LocalAI
  • FastChat
  • NEWAPI
  • OneAPI
  • etc.

V. Gestion des clés API ​

Sécurité des clés ​

IMPORTANT

Mécanisme de sécurité des clés API :

  • Les clés ne sont pas téléchargées sur un serveur
  • Stockage localisé dans le Windows Credential Manager
  • L'interface n'affiche que des masques (par exemple sk-***abc)
  • Désinstallation de MBAgent = nettoyage des clés

Visualisation et modification ​

  1. Paramètres → Provider
  2. Sélectionnez le Provider à gérer
  3. Vous pouvez :
    • Voir le masque de la clé
    • Modifier la clé
    • Supprimer la clé
    • Tester la connexion

Clés multiples ​

  • Différents Providers peuvent avoir des clés différentes
  • Vous pouvez configurer plusieurs clés pour le même Provider (pour la rotation)
  • Une clé = un quota indépendant

Rotation des clés ​

Recommandation : faites pivoter vos clés tous les 3-6 mois pour des raisons de sécurité :

  1. Créez une nouvelle clé sur le site du Provider
  2. Configurez la nouvelle clé dans MBAgent
  3. Vérifiez que la nouvelle clé fonctionne
  4. Supprimez l'ancienne clé
  5. Supprimez l'ancienne clé sur le site du Provider

VI. Routage intelligent ​

Qu'est-ce que le routage intelligent ? ​

Le routage intelligent sélectionne automatiquement le modèle le plus approprié en fonction du type de tâche :

Tâche simple → Modèle économique
Tâche moyenne → Modèle principal
Tâche complexe → Modèle phare

Configuration du routage ​

  1. Paramètres → Provider → Routage intelligent
  2. Activez le routage intelligent
  3. Configurez les règles :
Tâches de conversation → deepseek-v4-flash
Tâches de codage → deepseek-v4-pro
Tâches d'analyse → gemini-2.5-pro
Tâches de recherche → gpt-6.0-sol
Tâches d'images → deepseek-v4-vision

Avantages ​

  • ✅ Économise les coûts (les tâches simples utilisent des modèles peu coûteux)
  • ✅ Améliore la qualité (les tâches complexes utilisent des modèles puissants)
  • ✅ Automatique, aucune intervention manuelle nécessaire

VII. Optimisation des coûts ​

1. Choisir le bon modèle ​

  • Pour les tâches simples, n'utilisez pas de modèles coûteux
  • Basculez vers des modèles plus économiques après les tests

2. Définir le budget des tâches ​

Voir Aperçu des paramètres pour les détails.

3. Fermer les fonctions inutiles ​

  • Fermer l'affichage du processus de réflexion (économise les tokens)
  • Fermer les statistiques de tokens (économise l'affichage)
  • Limiter la fenêtre de contexte

4. Utiliser le cache ​

  • Activer le cache de préfixe (si pris en charge par le modèle)
  • Réutiliser les prompts courants

5. Surveiller l'utilisation ​

  • Vérifier régulièrement la consommation de tokens
  • Identifier les tâches qui consomment beaucoup
  • Optimiser les prompts trop longs

VIII. Problèmes courants ​

Q1 : "Échec de l'authentification API" ​

Causes possibles :

  • Clé API invalide ou expirée
  • Clé mal copiée (espaces, sauts de ligne)
  • Compte sans crédits

Solutions :

  1. Régénérez une clé
  2. Vérifiez qu'il n'y a pas d'espace
  3. Vérifiez les crédits du compte

Q2 : Le modèle est très lent ​

Causes possibles :

  • Réseau lent
  • Charge élevée du modèle
  • Modèle surdimensionné

Solutions :

  1. Passez à un modèle plus petit
  2. Vérifiez le réseau
  3. Essayez à un autre moment

Q3 : Réponse tronquée ​

Cause : La fenêtre de contexte est dépassée

Solutions :

  1. Démarrez une nouvelle session
  2. Compressez l'historique
  3. Utilisez un modèle à fenêtre de contexte plus grande

Q4 : Comment passer rapidement d'un modèle à l'autre ? ​

A : Cliquez sur le sélecteur de modèle dans la barre supérieure, sélectionnez un autre modèle, le changement prend effet immédiatement.

Q5 : Puis-je utiliser simultanément plusieurs Providers ? ​

A : Oui. Vous pouvez configurer plusieurs Providers et basculer librement.


IX. Prochaines étapes ​

  1. 📘 Panneau de tâches - Lancer des tâches prédéfinies
  2. 📘 Aperçu des paramètres - Configurer les paramètres détaillés
  3. 📘 Utilisation de la banque de mémoire IA - Mémoriser vos préférences

TIP

Recommandations pour économiser de l'argent :

  • Les tâches quotidiennes utilisent deepseek-v4-flash (le plus économique)
  • Le codage utilise deepseek-v4-pro (le plus rentable)
  • Les tâches complexes utilisent temporairement gpt-6.0-sol
  • Évitez d'utiliser claude-opus-4.5 pour des tâches simples