DeepSeek lanza V4-Flash-0731 para desafiar a OpenAI en rendimiento y coste

DeepSeek ha lanzado V4-Flash-0731, un nuevo modelo que supera a su propio buque insignia en nueve pruebas de rendimiento clave. Este lanzamiento reduce significativamente los precios del mercado al ofrecer tarifas un 30 por ciento inferiores a las del modelo GPT-5.6 Luna de OpenAI, recientemente rebajado.

Para los equipos empresariales, este cambio resalta la rápida comoditización de la inferencia de alto rendimiento. Acceder a capacidades de nivel superior a una fracción del coste permite un escalado más ambicioso de los flujos de trabajo de agentes y aplicaciones en tiempo real sin comprometer el presupuesto o la velocidad.

  • V4-Flash-0731 supera al anterior buque insignia de DeepSeek en nueve pruebas de rendimiento
  • El precio es un 30 por ciento inferior a las últimas tarifas con descuento del GPT-5.6 Luna de OpenAI
  • El lanzamiento intensifica la guerra de precios entre los proveedores de modelos de vanguardia para la inferencia de alta velocidad
  • El modelo está dirigido a desarrolladores que necesitan un alto rendimiento para tareas de automatización complejas
IA generativa Apps y plataformas de IA Agentes de IA y automatización
Todas las noticias de IA

Más noticias de IA

Modelos

OpenAI disuelve el equipo de preparación responsable de evaluar los riesgos catastróficos de la IA

Según se informa, OpenAI ha disuelto su equipo de preparación, el grupo encargado de evaluar y mitigar los posibles riesgos catastróficos de los modelos de IA avanzados. Esta reestructuración interna se produce tras varias salidas de alto perfil de las divisiones de seguridad y alineación de la empresa.

Modelos

Deepseek aumenta los precios de su API V4 hasta once veces antes de su supuesta salida a bolsa

DeepSeek ha implementado un aumento sustancial de precios para su API V4, con algunos costes subiendo hasta once veces a partir del 16 de agosto de 2026. Este cambio marca el fin de la estrategia de bajos costes que la empresa utilizó para irrumpir en el mercado en 2025. El ajuste coincide con informes del sector que sugieren que la firma se está preparando para una oferta pública inicial.

Modelos

Writer lanza una variante de GLM-5.2 optimizada para empresas con tecnología de ahorro de tokens

Writer ha lanzado una nueva variante del modelo de código abierto GLM-5.2, específicamente entrenada posteriormente para cumplir con los estándares de fiabilidad empresarial. Este lanzamiento introduce un arnés especializado diseñado para reducir significativamente el consumo de tokens, abordando directamente los altos costes operativos asociados con el despliegue de modelos a gran escala.

Ready to build something
extraordinary?

15 minutes. No pitch deck. Just a conversation about what AI can do for your team.

Talk directly with our AI specialists

15 min, sin compromiso
Sin presión comercial
Prototipo en 7 días