Google met à jour ses modèles Gemini légers alors que la sortie du modèle phare reste en attente

Google a publié des versions mises à jour de ses modèles Gemini 1.5 Flash, conçues pour offrir de meilleures performances et une latence réduite aux développeurs. Ces modèles plus petits sont destinés à gérer les tâches à haute fréquence plus efficacement que leurs homologues plus volumineux.

Pour les équipes en entreprise, ces mises à jour offrent une voie vers la réduction des coûts opérationnels lors du passage à l'échelle de l'IA en production. L'accent mis sur les modèles légers suggère une transition vers la priorité donnée à la vitesse et à l'efficacité économique pour l'automatisation réelle plutôt qu'à la seule taille du modèle.

  • Google a publié trois versions mises à jour de ses modèles Gemini légers
  • Les améliorations se concentrent sur la réduction de la latence et l'augmentation de la vitesse de traitement
  • Les mises à jour aident les développeurs à gérer des volumes de travail élevés de manière plus abordable
  • La sortie du prochain modèle phare reste retardée alors que l'efficacité occupe le devant de la scène
Applications & plateformes IA IA générative
Toutes les actualités IA

Plus d'actualités IA

Modèles

OpenAI dissout son équipe de préparation chargée d'évaluer les risques catastrophiques liés à l'IA

OpenAI aurait dissous son équipe de préparation, le groupe chargé d'évaluer et d'atténuer les risques catastrophiques potentiels des modèles d'IA avancés. Cette restructuration interne fait suite à plusieurs départs de haut niveau au sein des divisions de sécurité et d'alignement de l'entreprise.

Modèles

Deepseek augmente les tarifs de son API V4 jusqu'à onze fois avant une introduction en bourse annoncée

DeepSeek a mis en œuvre une augmentation substantielle des prix pour son API V4, certains coûts ayant été multipliés par onze au 16 août 2026. Ce changement marque la fin de la stratégie de bas prix utilisée par l'entreprise pour perturber le marché en 2025. Cet ajustement coïncide avec des rapports du secteur suggérant que la société se prépare à une introduction en bourse.

Modèles

Writer lance une variante de GLM-5.2 optimisée pour l'entreprise avec une technologie d'économie de jetons

Writer a lancé une nouvelle variante du modèle open-source GLM-5.2, spécifiquement post-entraînée pour répondre aux normes de fiabilité des entreprises. Cette version introduit un harnais spécialisé conçu pour réduire considérablement la consommation de jetons, répondant directement aux coûts opérationnels élevés associés au déploiement de modèles à grande échelle.

Ready to build something
extraordinary?

15 minutes. No pitch deck. Just a conversation about what AI can do for your team.

Talk directly with our AI specialists

15 min, sans engagement
Aucune pression commerciale
Prototype en 7 jours