Le Shanghai AI Lab publie le modèle ArchPreview utilisant la prédiction du concept suivant

Le Shanghai AI Lab a introduit ArchPreview, un modèle ouvert de 8,9 milliards de paramètres qui utilise une nouvelle méthode d'entraînement appelée Next Concept Prediction. Cette approche permet au modèle d'apprendre des concepts abstraits plutôt que de se concentrer uniquement sur les mots individuels. ArchPreview atteint une parité de performance avec le modèle OLMo-3-7B tout en ne nécessitant que la moitié des jetons d'entraînement.

Pour les équipes en entreprise, ce changement suggère une voie vers un entraînement de modèles plus efficace et des capacités de raisonnement améliorées. La réduction des besoins en jetons diminue considérablement le coût de calcul et le temps nécessaire pour développer des modèles personnalisés performants.

  • ArchPreview dispose de 8,9 milliards de paramètres et est publié en tant que modèle ouvert.
  • La technique Next Concept Prediction se concentre sur la signification sémantique plutôt que sur les séquences de mots.
  • Le modèle atteint des résultats de référence compétitifs en utilisant 50 pour cent de jetons d'entraînement en moins que les méthodes traditionnelles.
IA générative Machine Learning Applications & plateformes IA
Toutes les actualités IA

Plus d'actualités IA

Modèles

Le déploiement de LLM locaux réduit les coûts d'exploitation de l'IA à un pour cent

Une mise en œuvre récente utilisant des modèles de langage étendus locaux et le framework Jev a démontré une réduction significative des coûts d'exploitation des produits d'IA. En migrant les charges de travail des API cloud coûteuses vers une infrastructure locale, les développeurs ont réalisé une réduction des coûts de 99 pour cent, passant de 400 millions à 4 millions d'unités.

Modèles

Le modèle GPT-5.6 Sol (max) d'OpenAI entre dans le top 10 du classement SevenLab AI

Le dernier modèle d'OpenAI, GPT-5.6 Sol (max), a officiellement obtenu la dixième position du classement SevenLab AI. Ce classement spécifique est dérivé des données complètes d'ArtificialAnalysis et est ajusté pour refléter la valeur pour l'entreprise et les mesures de performance. Cette entrée marque une mise à jour importante du paysage concurrentiel pour les grands modèles de langage de haute performance disponibles pour les développeurs aujourd'hui.

Modèles

Anthropic et Accenture vont investir 2 milliards de dollars dans l'évaluation et la sécurité des modèles d'IA

Anthropic et Accenture ont annoncé un partenariat stratégique pour investir 2 milliards de dollars dans le développement de protocoles d'évaluation et de sécurité des modèles d'IA. Cette collaboration intervient alors que les développeurs font face à une pression croissante des régulateurs mondiaux, des parties prenantes en entreprise et des chercheurs pour garantir la sécurité et la prévisibilité des systèmes génératifs.

Ready to build something
extraordinary?

15 minutes. No pitch deck. Just a conversation about what AI can do for your team.

Talk directly with our AI specialists

15 min, sans engagement
Aucune pression commerciale
Prototype en 7 jours