OpenAI affirme que son silicium personnalisé surpasse le matériel Nvidia lors de tests de performance internes

OpenAI a révélé son intention de déployer ses propres puces personnalisées pour soutenir ses grands modèles de langage plus tard cette année. Des tests internes suggèrent que ces processeurs peuvent dépasser les performances du matériel Nvidia, la référence du secteur. Cette transition vise à optimiser l'infrastructure de l'entreprise pour ses charges de travail spécifiques en IA générative.

Les équipes en entreprise devraient noter la tendance vers la co-optimisation matériel-logiciel pour améliorer la vitesse d'inférence et réduire les coûts. Cette diversification de la couche matérielle pourrait à terme conduire à des prix plus compétitifs et à une meilleure disponibilité des ressources de calcul haute performance.

  • OpenAI a développé du silicium personnalisé pour réduire sa dépendance vis-à-vis des fournisseurs de GPU tiers.
  • Des tests de performance internes indiquent des gains de performance par rapport aux processeurs Nvidia actuels pour des tâches spécifiques.
  • L'entreprise prévoit de commencer à utiliser ces puces dans ses centres de données d'ici la fin de l'année 2024.
IA souveraine IA générative
Toutes les actualités IA

Plus d'actualités IA

Modèles

Le déploiement de LLM locaux réduit les coûts d'exploitation de l'IA à un pour cent

Une mise en œuvre récente utilisant des modèles de langage étendus locaux et le framework Jev a démontré une réduction significative des coûts d'exploitation des produits d'IA. En migrant les charges de travail des API cloud coûteuses vers une infrastructure locale, les développeurs ont réalisé une réduction des coûts de 99 pour cent, passant de 400 millions à 4 millions d'unités.

Modèles

Le modèle GPT-5.6 Sol (max) d'OpenAI entre dans le top 10 du classement SevenLab AI

Le dernier modèle d'OpenAI, GPT-5.6 Sol (max), a officiellement obtenu la dixième position du classement SevenLab AI. Ce classement spécifique est dérivé des données complètes d'ArtificialAnalysis et est ajusté pour refléter la valeur pour l'entreprise et les mesures de performance. Cette entrée marque une mise à jour importante du paysage concurrentiel pour les grands modèles de langage de haute performance disponibles pour les développeurs aujourd'hui.

Modèles

Anthropic et Accenture vont investir 2 milliards de dollars dans l'évaluation et la sécurité des modèles d'IA

Anthropic et Accenture ont annoncé un partenariat stratégique pour investir 2 milliards de dollars dans le développement de protocoles d'évaluation et de sécurité des modèles d'IA. Cette collaboration intervient alors que les développeurs font face à une pression croissante des régulateurs mondiaux, des parties prenantes en entreprise et des chercheurs pour garantir la sécurité et la prévisibilité des systèmes génératifs.

Ready to build something
extraordinary?

15 minutes. No pitch deck. Just a conversation about what AI can do for your team.

Talk directly with our AI specialists

15 min, sans engagement
Aucune pression commerciale
Prototype en 7 jours