DeepSeek lance V4-Flash-0731 pour défier OpenAI sur la performance et le coût

DeepSeek a lancé V4-Flash-0731, un nouveau modèle qui surpasse son propre fleuron sur neuf tests de référence clés. Cette version casse les prix du marché en proposant des tarifs 30 pour cent inférieurs au modèle GPT-5.6 Luna d'OpenAI récemment réduit.

Pour les équipes en entreprise, ce changement souligne la commoditisation rapide de l'inférence haute performance. L'accès à des capacités de pointe pour une fraction du coût permet une mise à l'échelle plus ambitieuse des flux de travail agentiques et des applications en temps réel sans compromis sur le budget ou la rapidité.

  • V4-Flash-0731 surpasse le précédent fleuron de DeepSeek dans neuf tests de performance
  • Les prix sont 30 pour cent inférieurs aux derniers tarifs réduits du GPT-5.6 Luna d'OpenAI
  • Cette sortie intensifie la guerre des prix entre les fournisseurs de modèles de pointe pour l'inférence à haute vitesse
  • Le modèle cible les développeurs ayant besoin d'un débit élevé pour des tâches d'automatisation complexes
IA générative Applications & plateformes IA Agents IA & automatisation
Toutes les actualités IA

Plus d'actualités IA

Modèles

OpenAI dissout son équipe de préparation chargée d'évaluer les risques catastrophiques liés à l'IA

OpenAI aurait dissous son équipe de préparation, le groupe chargé d'évaluer et d'atténuer les risques catastrophiques potentiels des modèles d'IA avancés. Cette restructuration interne fait suite à plusieurs départs de haut niveau au sein des divisions de sécurité et d'alignement de l'entreprise.

Modèles

Deepseek augmente les tarifs de son API V4 jusqu'à onze fois avant une introduction en bourse annoncée

DeepSeek a mis en œuvre une augmentation substantielle des prix pour son API V4, certains coûts ayant été multipliés par onze au 16 août 2026. Ce changement marque la fin de la stratégie de bas prix utilisée par l'entreprise pour perturber le marché en 2025. Cet ajustement coïncide avec des rapports du secteur suggérant que la société se prépare à une introduction en bourse.

Modèles

Writer lance une variante de GLM-5.2 optimisée pour l'entreprise avec une technologie d'économie de jetons

Writer a lancé une nouvelle variante du modèle open-source GLM-5.2, spécifiquement post-entraînée pour répondre aux normes de fiabilité des entreprises. Cette version introduit un harnais spécialisé conçu pour réduire considérablement la consommation de jetons, répondant directement aux coûts opérationnels élevés associés au déploiement de modèles à grande échelle.

Ready to build something
extraordinary?

15 minutes. No pitch deck. Just a conversation about what AI can do for your team.

Talk directly with our AI specialists

15 min, sans engagement
Aucune pression commerciale
Prototype en 7 jours