Moonshot AI suspende las suscripciones de Kimi K3 al alcanzar el límite de su capacidad de cómputo

Moonshot AI ha suspendido las nuevas suscripciones para su modelo Kimi K3 tras un aumento masivo en la demanda de los usuarios en un periodo de 48 horas. La startup china informó que la afluencia repentina de tráfico sobrepasó su infraestructura de cómputo existente. Esta pausa temporal permite al equipo estabilizar el rendimiento para los usuarios actuales mientras trabajan en la ampliación de sus recursos de hardware.

Este incidente resalta la importancia crítica del escalado elástico y la planificación robusta de la infraestructura para los despliegues de IA de nivel empresarial. Los equipos deben anticipar curvas de demanda volátiles y asegurar que su backend pueda manejar un crecimiento rápido para evitar interrupciones del servicio que afecten los flujos de trabajo de producción.

  • Las suscripciones de Kimi K3 se pausaron tras un pico de tráfico de 48 horas.
  • La capacidad de la infraestructura no pudo mantener el rendimiento bajo la carga repentina.
  • Moonshot AI está priorizando la estabilidad del servicio para los usuarios empresariales e individuales existentes.
IA soberana Apps y plataformas de IA IA generativa
Todas las noticias de IA

Más noticias de IA

Modelos

OpenAI disuelve el equipo de preparación responsable de evaluar los riesgos catastróficos de la IA

Según se informa, OpenAI ha disuelto su equipo de preparación, el grupo encargado de evaluar y mitigar los posibles riesgos catastróficos de los modelos de IA avanzados. Esta reestructuración interna se produce tras varias salidas de alto perfil de las divisiones de seguridad y alineación de la empresa.

Modelos

Deepseek aumenta los precios de su API V4 hasta once veces antes de su supuesta salida a bolsa

DeepSeek ha implementado un aumento sustancial de precios para su API V4, con algunos costes subiendo hasta once veces a partir del 16 de agosto de 2026. Este cambio marca el fin de la estrategia de bajos costes que la empresa utilizó para irrumpir en el mercado en 2025. El ajuste coincide con informes del sector que sugieren que la firma se está preparando para una oferta pública inicial.

Modelos

Writer lanza una variante de GLM-5.2 optimizada para empresas con tecnología de ahorro de tokens

Writer ha lanzado una nueva variante del modelo de código abierto GLM-5.2, específicamente entrenada posteriormente para cumplir con los estándares de fiabilidad empresarial. Este lanzamiento introduce un arnés especializado diseñado para reducir significativamente el consumo de tokens, abordando directamente los altos costes operativos asociados con el despliegue de modelos a gran escala.

Ready to build something
extraordinary?

15 minutes. No pitch deck. Just a conversation about what AI can do for your team.

Talk directly with our AI specialists

15 min, sin compromiso
Sin presión comercial
Prototipo en 7 días