Volver al blog
Tecnología 7 min de lectura

Cuando el modelo que has elegido no contesta

Los proveedores de IA se caen. Todos, algún día. Lo que distingue a un asistente serio no es prometer que no pasará, sino qué hace cuando pasa. Te contamos nuestro sistema de respaldo en tres niveles, y por qué preferimos avisarte antes que disimular.

Un día cualquiera, el proveedor del modelo que has elegido deja de responder. No es una hipótesis: pasa. Se cae un servicio, se agota un límite, caduca una credencial, un centro de datos tiene un mal rato. Ocurre en todas las aplicaciones de IA del mundo, incluidas las grandes.

Lo que cambia de una app a otra es qué ves tú cuando eso ocurre. Y ahí hay tres respuestas posibles, de peor a mejor: que se quede en blanco, que conteste otro modelo sin decírtelo, o que conteste otro modelo y te lo diga.

Nosotros hacemos la tercera. Vale la pena contar cómo, porque es un buen ejemplo de que las decisiones aburridas son las que sostienen un producto.

Tres niveles, y el tercero no depende de nadie

Cuando el modelo que has pedido no responde, no nos rendimos a la primera. Hay una escalera:

Nivel 1 — un modelo rápido del mismo proveedor. Si el problema era ese modelo en concreto (un pico de carga, un parámetro que no le gustó), un hermano pequeño del mismo sitio suele contestar sin problema.

Nivel 2 — un segundo proveedor. Otra empresa, otra infraestructura, otra credencial. Si lo que ha fallado es el proveedor entero, aquí es donde se sale del incendio.

Nivel 3 — el respaldo automático. Este es el importante, y llegó después de aprender por las malas. Los dos niveles de arriba tienen un punto débil: uno comparte credencial con el modelo que acaba de fallar, y el otro depende de que alguien haya configurado unas variables. El día que fallan los dos a la vez, la app se queda muda teniendo un segundo proveedor sano y configurado.

Así que el tercer nivel no pregunta a ninguna configuración: mira la lista de proveedores que ya están dados de alta en el sistema y usa el primero que esté sano. Si mañana se añade uno nuevo, entra solo en la escalera sin que nadie tenga que acordarse de nada.

Lo que se ve en pantalla

Aquí está la parte que más nos importa. Cuando responde un respaldo, el mensaje lleva una línea encima:

Respondió GarBotGPT-Respaldo porque GarBotGPT-5.6-Luna no estaba disponible.

Parece un detalle menor. No lo es. Durante un tiempo, nuestro sistema sustituía el modelo en silencio: pedías el modelo grande, contestaba el pequeño y la interfaz seguía mostrando el nombre del grande, tan tranquila. El resultado es el peor posible: crees que el modelo bueno responde mal. Escribes en el chat "este modelo es malísimo" y estás juzgando a otro.

Sustituir en silencio es peor que fallar de cara. Ahora el aviso viaja con el mensaje y sobrevive a recargar la página, porque queda guardado con él.

Y lo que no se ve: no te cobramos lo que no has usado

El mismo problema tenía una versión económica. Si pides un modelo caro y contesta el de respaldo, ¿qué se cobra?

Antes, el caro. La identidad no se reasignaba, así que el sistema apuntaba el precio del modelo que habías pedido por una respuesta que había escrito otro. Ahora, en cuanto entra un respaldo, la identidad, el registro y el coste pasan a ser los del modelo que ha contestado de verdad. Si el que responde es un modelo que a nosotros no nos cuesta nada, a ti tampoco.

Los límites de tu plan, en cambio, se comprueban con el modelo que pediste, no con el que respondió. Y es a propósito: pediste el modelo premium y el sistema intentó dártelo. Que fallara no es motivo para regalarte un uso, ni para quitártelo dos veces.

Si el fallo llega a mitad de frase

Hay un caso especialmente traicionero: la respuesta ha empezado a escribirse y el proveedor se cae en la palabra doscientos.

Lo fácil es que el chat trate ese corte como un final normal. Escribe "respuesta completada", pone el visto, y tú te quedas con medio texto presentado como si estuviera entero. Es un fallo silencioso de los que dan miedo, porque nada indica que falte nada.

Un corte inesperado a mitad de emisión se trata como lo que es: una respuesta interrumpida. Se marca como truncada, aparece el botón de continuar, y lo escrito hasta ese momento no se pierde. Sabes que falta algo, que es justo lo que necesitas saber.

Todo fallo queda apuntado

Durante mucho tiempo tuvimos un registro de uso perfecto en el que todas las peticiones figuraban como correctas. Miles de filas, ni un solo error. Sonaba estupendo y significaba lo contrario de lo que parecía: el registro se escribía al final del camino feliz, así que un fallo no quedaba anotado en ninguna parte. Estábamos ciegos precisamente cuando hacía falta ver.

Hoy se apunta cada camino que acaba mal —el rechazo del proveedor, el contexto desbordado, el proveedor inalcanzable y cada uno de los respaldos— con su motivo literal, sin tokens y sin coste. Lo que más importa de todo eso son los respaldos: son los casos en los que la app funcionó pero no como debía, y son exactamente los que se pierden si solo miras si hubo respuesta o no.

Lo que este sistema no hace

Por honestidad, tres límites:

Un respaldo suele ser un modelo más flojo. Si pediste el mejor modelo para un problema difícil y contestó el de emergencia, la respuesta puede ser peor. Por eso lo avisamos: para que puedas volver a preguntar más tarde en vez de dar por buena una respuesta mediocre.

No hay cambio de modelo a mitad de respuesta. Si el corte llega con el texto ya empezado, no reescribimos desde cero con otro modelo: te decimos que se interrumpió y te dejamos continuar.

Un respaldo no arregla el problema de fondo. Es una red, no un suelo. Si el proveedor principal lleva días fallando, la solución es arreglarlo, no vivir en la red.

Por qué contamos esto

Porque es el tipo de cosa que nadie enseña en una demo. Una demo muestra la respuesta bonita del primer intento. Lo que de verdad separa un juguete de una herramienta es lo que pasa el mal día: si te deja tirado, si te engaña, o si te dice la verdad y sigue funcionando.

La próxima vez que veas ese aviso encima de un mensaje, ya sabes lo que hay detrás.

Prueba todo esto en GarBotGPT.

500 créditos gratis, sin tarjeta. Modelos top, herramientas en vivo y RAG sobre tus propios documentos.