SambaNova Systems, Inc. est une entreprise américaine spécialisée dans les infrastructures d’intelligence artificielle, installée à Palo Alto, en Californie. Elle conçoit une architecture de calcul dédiée aux réseaux de neurones et les logiciels nécessaires à son exploitation. Son positionnement repose sur une intégration étroite entre matériel et logiciel : plutôt que de commercialiser uniquement une puce, SambaNova propose un environnement destiné à entraîner, adapter ou exécuter des modèles. Son site officiel est sambanova.ai.
Une origine ancrée dans la recherche de Stanford
Créée en 2017, SambaNova réunit trois cofondateurs aux profils complémentaires : Rodrigo Liang, ancien dirigeant dans les semi-conducteurs, et deux chercheurs de Stanford, Kunle Olukotun et Christopher Ré. Le premier apporte son expérience du développement de processeurs et de leur industrialisation ; les seconds, leurs travaux sur les architectures informatiques et l’apprentissage automatique. L’entreprise s’est construite autour d’une question : comment adapter le calcul aux besoins des modèles plutôt que contraindre ces modèles à une architecture généraliste ?
Cette ambition a attiré plusieurs investisseurs institutionnels et industriels, dont SoftBank Vision Fund 2, Intel Capital et GV. Ces soutiens ont accompagné le développement d’une offre intégrée dans un secteur où la conception de puces, les logiciels et la commercialisation nécessitent des ressources importantes. SambaNova a progressivement élargi son discours, initialement centré sur les systèmes de calcul, vers les usages de l’IA générative en entreprise.
Des puces spécialisées aux services d’inférence
Le socle technologique de SambaNova est la Reconfigurable Dataflow Unit, ou RDU. Ce processeur organise le traitement autour des flux de données et d’une architecture reconfigurable. Avec son logiciel SambaFlow, l’entreprise cherche à optimiser l’exécution des modèles et les déplacements de données, un enjeu déterminant pour les performances et la consommation énergétique. Ses systèmes DataScale associent ces composants dans une infrastructure destinée aux charges de travail d’IA.
L’offre s’est aussi développée autour de l’inférence, c’est-à-dire l’utilisation d’un modèle déjà entraîné pour produire une réponse. Lancé en 2024, SambaNova Cloud permet d’accéder à des modèles par API, sans installer les équipements correspondants chez le client. L’entreprise propose notamment l’exécution de modèles à poids ouverts, dont ceux de la famille Llama de Meta. Selon les offres, elle s’adresse également aux organisations souhaitant déployer une infrastructure dédiée et mieux maîtriser leurs données. La promesse commerciale porte autant sur l’accès au calcul que sur la réduction de la complexité d’intégration.
Et maintenant ?
Pour SambaNova, l’enjeu est de transformer sa différenciation matérielle en adoption durable. Face à l’écosystème des GPU et aux autres spécialistes de l’inférence, la seule vitesse ne suffit pas : coût d’usage, disponibilité, compatibilité logicielle et simplicité d’exploitation pèseront dans les choix des clients. La progression des modèles ouverts peut favoriser son approche, mais impose une adaptation continue. Sa capacité à documenter les performances en conditions réelles et à accompagner les déploiements sera déterminante pour élargir sa place dans l’IA d’entreprise.