
Los modelos de Anthropic, OpenAI y xAI sufrieron el jueves por la mañana una serie de interrupciones poco habituales, lo que provocó un tiempo de inactividad en sus respectivos chatbots. SpaceX, la empresa matriz de xAI, afirmó el jueves por la tarde que los problemas con Grok se debieron a “una interrupción en nuestro centro de datos de Memphis esta mañana”.
¿Coincidencia?
En un primer momento, parecía que los problemas estaban relacionados, ya que coincidieron (quizás como consecuencia de un proveedor de servicios externo compartido). Pero ni OpenAI ni Anthropic mencionaron alguna fuente externa en las declaraciones que hicieron a WIRED el jueves. SpaceX no respondió a la solicitud de comentarios. Sin embargo, la empresa declaró públicamente: “También queremos pedir disculpas a nuestros socios de computación afectados”. Anthropic y xAI anunciaron en mayo una “colaboración en materia de computación” con SpaceX.
La portavoz de OpenAI, Kathleen Chaykowski, explica a WIRED: “Un error de enrutamiento que se produjo alrededor de las 7:43 de la mañana (hora del Pacífico) del jueves 3 de septiembre provocó que ChatGPT y Codex dejaran de estar disponibles para algunos usuarios en todas las plataformas. Hacia las 8:17 de la mañana (hora del Pacífico) del mismo jueves, se implementó con éxito una solución y se sigue supervisando la situación”.
Anthropic se negó a hacer comentarios sobre el incidente
La empresa comenzó a alertar sobre una “interrupción parcial” a las 6:23 de la mañana (hora del Pacífico) del mismo día Implicaba “un aumento de los errores en las solicitudes dirigidas a Claude Mythos 5.1, Claude Fable 5.1 y Claude Opus 5”. Poco después, la empresa aseguró que había “identificado la causa” y que “se había aplicado una solución”. La compañía marcó el problema como resuelto a las 9:16 de la mañana (hora del Pacífico). Claude Sonnet 5 pareció sufrir problemas similares de forma breve poco después de las 9 de la mañana (hora del Pacífico).
xAI informó de interrupciones en Grok en todas sus plataformas y servicios a partir de las 6:30 de la mañana (hora del Pacífico), momento en el que publicó “investigando la interrupción” en su página de estado del servicio. “Grok está experimentando problemas. Estamos trabajando para restablecer el servicio lo antes posible”, indicaba la página. A las 10:05 de la mañana (hora del Pacífico), el incidente se marcó como resuelto. “Hemos resuelto la situación y el tráfico vuelve a funcionar con normalidad”, escribió la empresa.
También hubo informes aislados sobre una posible interrupción del servicio de Google Gemini el jueves por la mañana, pero la compañía no lo confirmó ni registró ningún incidente en su panel de estado del servicio. Google no respondió a la solicitud de comentarios de WIRED antes de la publicación.
Normalmente, varias interrupciones en el mismo sector y al mismo tiempo apuntarían a que un proveedor de servicios en la nube, una red de distribución de contenidos u otro proveedor externo tiene problemas que afectan a varios clientes. Sin embargo, ni OpenAI ni Anthropic señalaron una posible causa común. Los principales actores del sector de la infraestructura de internet (entre ellos Cloudflare, Amazon Web Services y Microsoft Azure) no notificaron interrupciones del servicio el jueves.
En fin, es difícil saber si estas interrupciones fueron o no una casualidad, pero el hecho de que cada vez más los modelos de IA comparten servicios o están interconectados podría traer más eventos de este tipo.
Artículo originalmente publicado en WIRED.com. Adaptado por Mauricio Serfatty Godoy.












