Sarvam AI annonce son intention de développer un modèle à mille milliards de paramètres

La startup Sarvam AI, basée à Bengaluru, a révélé son intention de développer un modèle d'intelligence artificielle à mille milliards de paramètres. Ce projet ambitieux vise à repousser les limites de l'entraînement de modèles à grande échelle tout en répondant aux exigences linguistiques et structurelles uniques du marché indien. Cette initiative représente une étape importante dans le développement régional de l'IA, en se concentrant sur des capacités de haute performance.

Pour les équipes d'entreprise qui construisent des systèmes de production, l'émergence de modèles régionaux à mille milliards de paramètres suggère un avenir où l'infrastructure souveraine offre des alternatives de haute performance aux plateformes mondiales. Ce développement souligne l'importance des données d'entraînement localisées et des configurations matérielles spécialisées pour atteindre des performances de pointe sur des marchés spécifiques.

  • Sarvam AI vise une échelle de mille milliards de paramètres pour rivaliser avec les modèles génératifs les plus avancés au monde.
  • Le projet vise à surmonter les défis géopolitiques et d'infrastructure inhérents au calcul à grande échelle.
  • L'accent est mis sur la création d'une IA de haute performance adaptée aux nuances linguistiques régionales.
  • La startup se positionne pour diriger le développement d'une infrastructure d'IA souveraine en Asie du Sud.
IA souveraine IA générative Machine Learning
Toutes les actualités IA

Plus d'actualités IA

Outils

Equinix renforce son rôle dans l'infrastructure d'IA grâce à un partenariat approfondi avec Nvidia

Equinix s'appuie sur son empreinte historique de centres de données pour proposer des services de colocalisation spécialisés pour les charges de travail d'IA. En approfondissant son partenariat avec Nvidia, l'entreprise offre aux entreprises des clouds privés gérés pour le calcul haute performance.

Modèles

Anthropic restreint l'accès à Claude en raison de risques liés aux armes biologiques et à la surveillance

Anthropic aurait mis fin à l'accès à son assistant Claude pour certains utilisateurs identifiés comme menant des recherches sensibles. L'entreprise basée aux États-Unis a signalé des activités qui pourraient potentiellement contribuer au développement d'armes biologiques ou de programmes de surveillance non autorisés, renforçant ainsi son engagement envers les protocoles de sécurité.

Modèles

Le Shanghai AI Lab publie le modèle ArchPreview utilisant la prédiction du concept suivant

Le Shanghai AI Lab a introduit ArchPreview, un modèle ouvert de 8,9 milliards de paramètres qui utilise une nouvelle méthode d'entraînement appelée Next Concept Prediction. Cette approche permet au modèle d'apprendre des concepts abstraits plutôt que de se concentrer uniquement sur les mots individuels. ArchPreview atteint une parité de performance avec le modèle OLMo-3-7B tout en ne nécessitant que la moitié des jetons d'entraînement.

Ready to build something
extraordinary?

15 minutes. No pitch deck. Just a conversation about what AI can do for your team.

Talk directly with our AI specialists

15 min, sans engagement
Aucune pression commerciale
Prototype en 7 jours