Dans un client Gemini API ou Google AI Studio qui expose les statuts gRPC, l’erreur 13 correspond à INTERNAL : le service a rencontré une erreur interne et n’a pas produit la réponse attendue.
La documentation Gemini associe les erreurs HTTP 500 à INTERNAL et recommande de vérifier l’état du service, de réduire le contexte, d’essayer temporairement un autre modèle, d’attendre puis de retenter. Un code 13 ne prouve donc ni un quota épuisé ni une clé API invalide.
L’essentiel en 30 secondes
Conservez le code complet, l’heure, le modèle et l’identifiant de requête, puis vérifiez l’état de Gemini API. Retentez une seule fois avec une requête minimale et sans fichier. Si elle fonctionne, réintroduisez le contexte par étapes. Pour un appel automatisé, utilisez un nombre limité de nouvelles tentatives avec délai exponentiel et aléa.
Code gRPC 13, erreur HTTP 500 ou message de l’application ?
Le code 13 INTERNAL appartient à la nomenclature gRPC. L’API Gemini peut aussi renvoyer un statut HTTP 500 INTERNAL. Relevez le message complet et la bibliothèque utilisée : un nombre affiché dans l’application Gemini ne suffit pas à établir qu’il s’agit du même problème. Les étapes ci-dessous concernent un appel d’API dont le contexte est identifié.
Comment identifier la cause avant d’agir ?
Le chiffre 13 n’a de sens qu’avec la surface et le message associés. Dans l’application grand public, recopiez le texte exact avant d’appliquer un diagnostic API. Dans AI Studio, un notebook ou un SDK, séparez erreur interne, entrée trop longue, modèle particulier et incident régional.
Quel diagnostic correspond au symptôme ?
| Situation | Indice décisif | Priorité |
|---|---|---|
| Surface non identifiée | le message ne montre qu’un nombre sans statut HTTP ni nom de service | recopier le message complet et identifier le produit, le modèle et la méthode d’appel |
| Incident interne | plusieurs modèles ou projets renvoient des erreurs 5xx au même moment | consulter l’état, attendre puis retenter avec un backoff limité |
| Contexte trop volumineux | une phrase courte fonctionne mais le prompt complet renvoie INTERNAL | réduire l’historique et réintroduire pièces, outils et instructions par étapes |
| Modèle ou fonction | l’erreur reste attachée à un modèle, une préversion, un outil ou un type de média | tester un modèle stable compatible et vérifier ses limites documentées |
| Client ou stratégie de relance | les erreurs s’accumulent, les doublons apparaissent ou le client expire avant la réponse | mettre à jour le SDK, journaliser les statuts et limiter les retries avec backoff |
Quelle procédure suivre dans le bon ordre ?
Du symptôme à une preuve contrôlable
-
Capturer le contexte
Notez code, message, statut HTTP, heure, modèle, client et identifiant de requête sans secret.
Contrôle : l’erreur peut être reliée à une surface précise
-
Vérifier l’état
Consultez l’historique de service correspondant à Gemini API ou Vertex AI.
Contrôle : un incident connu est confirmé ou exclu
-
Créer une requête minimale
Testez une phrase courte sans fichier, outil ni historique sur le même modèle.
Contrôle : la disponibilité de base est mesurée
-
Réintroduire par étapes
Ajoutez contexte, médias et fonctions un élément à la fois, puis comparez un modèle compatible.
Contrôle : la taille, la fonction ou le modèle déclencheur est localisé
-
Relancer ou signaler
Utilisez un backoff limité et idempotent, puis transmettez une reproduction expurgée si l’échec persiste.
Contrôle : le service n’est pas surchargé par les essais et le ticket contient des preuves
Ne publiez jamais une clé API, un jeton, un prompt confidentiel ou des données client dans une capture ou un forum. Révoquez immédiatement toute clé exposée et fournissez au support une reproduction expurgée.
Le code vient-il de l’application, d’AI Studio, d’un SDK ou de Vertex AI ?
Le message ne montre qu’un nombre sans statut HTTP ni nom de service. La même valeur peut être présentée différemment selon le client.
À faire : recopier le message complet et identifier le produit, le modèle et la méthode d’appel. Évitez d’appliquer un correctif d’API à l’application grand public sans preuve.
La requête minimale échoue-t-elle aussi pendant un incident déclaré ?
Plusieurs modèles ou projets renvoient des erreurs 5xx au même moment. Le service Google peut rencontrer une panne ou une surcharge temporaire.
À faire : consulter l’état, attendre puis retenter avec un backoff limité. Évitez de relancer en boucle sans délai.
Le défaut disparaît-il sans historique ou fichier ?
Une phrase courte fonctionne mais le prompt complet renvoie INTERNAL. La documentation cite un contexte d’entrée trop long comme cause possible de 500 INTERNAL.
À faire : réduire l’historique et réintroduire pièces, outils et instructions par étapes. Évitez d’envoyer le même contexte volumineux à répétition.
Un autre modèle pris en charge accepte-t-il la requête témoin ?
L’erreur reste attachée à un modèle, une préversion, un outil ou un type de média. Une fonction temporairement instable peut échouer sans rendre tout Gemini indisponible.
À faire : tester un modèle stable compatible et vérifier ses limites documentées. Évitez de supposer que tous les modèles ont les mêmes capacités.
Le SDK ferme-t-il la connexion ou rejoue-t-il mal le job ?
Les erreurs s’accumulent, les doublons apparaissent ou le client expire avant la réponse. Les délais, versions et relances non idempotentes peuvent masquer le résultat réel.
À faire : mettre à jour le SDK, journaliser les statuts et limiter les retries avec backoff. Évitez de relancer indéfiniment une création coûteuse.
Quelles traces rendent un code 13 réellement exploitable ?
Consignez l’heure avec le fuseau, le modèle exact, la région ou le point de terminaison, le SDK et sa version, ainsi que le statut HTTP et le message complet. Ajoutez l’identifiant de requête s’il est fourni. Ne collez jamais la clé API, le jeton d’accès ou le contenu confidentiel du prompt dans un ticket public. Un code isolé sans contexte ne permet pas de distinguer AI Studio, Gemini API et Vertex AI.
Construisez une requête témoin courte avec une phrase neutre, sans outil, image, vidéo, document ni historique. Si elle passe sur le même modèle, le service général fonctionne et la taille ou un élément du contexte mérite d’être réintroduit progressivement. Si elle échoue aussi, comparez un second modèle disponible et la page d’état. Ne changez pas simultanément modèle, région, clé, bibliothèque et réseau, car le résultat deviendrait impossible à attribuer.
Pour un traitement par lot, isolez l’élément fautif et rendez la relance idempotente. Un statut interne peut survenir après qu’une partie du travail a été acceptée. Avant de rejouer une opération coûteuse, vérifiez l’état du job et les sorties déjà créées. Ajoutez un nombre maximal de tentatives, un délai exponentiel et un peu d’aléa afin de ne pas amplifier un incident de capacité.
Si l’erreur persiste avec une entrée minimale, un modèle pris en charge et aucun incident public, utilisez le bouton de retour d’AI Studio ou le canal de support associé au projet. Joignez les métadonnées et une reproduction expurgée. La preuve utile est une requête minimale qui échoue régulièrement, pas une capture contenant des secrets.
Consultez aussi notre article sur la structuration d’un travail avec une IA. Un contexte plus court et découpé rend le diagnostic et la reprise plus fiables.
Consultez aussi notre article sur les outils du travail numérique. Un journal de test et un environnement reproductible accélèrent le support technique.
Quand signaler l’erreur 13 à Google ?
Signalez si une requête minimale échoue de manière répétée sur un modèle pris en charge, sans incident déclaré, après mise à jour du client et nouvelles tentatives espacées. Pour documenter le problème, préparez : heure et fuseau, produit, projet expurgé, région, modèle, SDK, statut HTTP, code 13, identifiant de requête et reproduction minimale sans secret.
Utilisez Envoyer des commentaires dans Google AI Studio ou le support Google Cloud lié au projet pour Vertex AI. Le support peut corréler les identifiants et journaux du service, mais aura besoin d’une reproduction propre et ne doit jamais recevoir votre clé en clair.
Sources officielles
- Google AI : résoudre les erreurs Gemini API
- gRPC : code 13 INTERNAL
- Google AI : comprendre les limites de débit
- Google Cloud : historique Vertex Gemini API
Questions fréquentes
Que signifie le code 13 dans Gemini ?
Dans un client qui expose les statuts gRPC, le code 13 signifie INTERNAL, une erreur interne du service.
L’erreur 13 veut-elle dire que le quota est dépassé ?
Non. Un quota épuisé utilise normalement un autre statut ; conservez le message complet avant de conclure.
Faut-il relancer immédiatement la même requête ?
Attendez, vérifiez l’état puis utilisez un nombre limité de tentatives avec délai exponentiel et aléa.
Pourquoi une requête courte fonctionne-t-elle ?
Le contexte complet, un fichier, un outil ou une limite propre au modèle peut déclencher l’échec interne.
Quelles informations envoyer au support ?
Transmettez heure, modèle, client, statut, identifiant de requête et reproduction minimale, sans clé ni donnée confidentielle.



